Query 018806
Match_columns 350
No_of_seqs 464 out of 3556
Neff 10.9
Searched_HMMs 46136
Date Fri Mar 29 04:11:23 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/018806.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/018806hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG0271 Notchless-like WD40 re 100.0 1.9E-35 4.1E-40 240.8 22.8 242 98-345 114-460 (480)
2 KOG0271 Notchless-like WD40 re 100.0 1.1E-35 2.5E-40 242.1 18.3 244 74-326 108-478 (480)
3 KOG0272 U4/U6 small nuclear ri 100.0 1.2E-33 2.5E-38 233.1 17.4 220 100-349 176-400 (459)
4 KOG0272 U4/U6 small nuclear ri 100.0 2.4E-34 5.3E-39 237.0 13.1 215 101-345 219-439 (459)
5 KOG2139 WD40 repeat protein [G 100.0 4.8E-32 1E-36 219.7 23.1 330 1-350 1-341 (445)
6 KOG0263 Transcription initiati 100.0 3.2E-32 7E-37 240.7 18.9 196 100-325 452-650 (707)
7 KOG0279 G protein beta subunit 100.0 3.4E-31 7.3E-36 207.7 19.7 196 101-326 65-264 (315)
8 KOG0286 G-protein beta subunit 100.0 1.2E-30 2.5E-35 206.0 20.8 243 74-345 48-324 (343)
9 KOG0273 Beta-transducin family 100.0 1.6E-30 3.6E-35 217.2 21.6 219 101-329 237-482 (524)
10 KOG0315 G-protein beta subunit 100.0 1.3E-29 2.9E-34 195.8 22.8 214 98-341 82-305 (311)
11 KOG0279 G protein beta subunit 100.0 3.2E-29 6.9E-34 196.7 21.1 194 100-324 106-313 (315)
12 KOG0645 WD40 repeat protein [G 100.0 1.7E-28 3.7E-33 191.9 23.4 197 102-324 17-223 (312)
13 KOG0318 WD40 repeat stress pro 100.0 1.4E-28 3E-33 208.5 24.3 267 74-344 140-581 (603)
14 KOG0284 Polyadenylation factor 100.0 4.8E-30 1E-34 210.9 12.9 219 100-348 97-318 (464)
15 KOG0263 Transcription initiati 100.0 1E-28 2.2E-33 218.6 18.6 216 101-344 380-627 (707)
16 KOG0291 WD40-repeat-containing 100.0 1.1E-27 2.4E-32 210.9 22.5 199 100-326 351-552 (893)
17 KOG0284 Polyadenylation factor 100.0 1.3E-28 2.8E-33 202.6 14.2 217 99-345 138-359 (464)
18 KOG0295 WD40 repeat-containing 100.0 6.1E-28 1.3E-32 195.9 17.8 215 102-345 153-385 (406)
19 KOG0265 U5 snRNP-specific prot 100.0 1.5E-27 3.3E-32 189.1 19.6 208 74-327 40-249 (338)
20 KOG0286 G-protein beta subunit 100.0 2.6E-27 5.6E-32 187.2 20.4 182 102-314 148-334 (343)
21 KOG0266 WD40 repeat-containing 100.0 4.2E-27 9.1E-32 212.0 24.5 213 99-338 159-378 (456)
22 KOG0266 WD40 repeat-containing 100.0 1.3E-26 2.7E-31 208.9 24.1 217 99-345 203-431 (456)
23 KOG0285 Pleiotropic regulator 100.0 2.4E-27 5.2E-32 192.2 16.5 207 101-339 153-363 (460)
24 KOG0282 mRNA splicing factor [ 100.0 2.4E-27 5.2E-32 199.1 14.5 224 70-315 203-494 (503)
25 KOG0315 G-protein beta subunit 99.9 5.6E-26 1.2E-30 175.8 19.6 224 76-336 24-258 (311)
26 KOG0273 Beta-transducin family 99.9 1.1E-25 2.3E-30 188.6 22.3 198 99-323 276-522 (524)
27 PTZ00421 coronin; Provisional 99.9 1.1E-24 2.4E-29 195.8 28.6 202 99-328 75-292 (493)
28 KOG0645 WD40 repeat protein [G 99.9 4E-24 8.7E-29 167.5 24.2 194 101-324 63-261 (312)
29 KOG0278 Serine/threonine kinas 99.9 2E-25 4.4E-30 172.9 15.6 214 70-314 48-286 (334)
30 KOG0296 Angio-associated migra 99.9 2.2E-24 4.7E-29 175.5 22.2 245 73-323 56-397 (399)
31 KOG0319 WD40-repeat-containing 99.9 7.7E-25 1.7E-29 192.7 21.0 223 102-342 368-595 (775)
32 KOG0291 WD40-repeat-containing 99.9 1.6E-24 3.6E-29 191.1 23.0 195 100-324 308-508 (893)
33 KOG0295 WD40 repeat-containing 99.9 2.3E-24 5E-29 175.3 20.2 193 100-322 194-404 (406)
34 KOG1407 WD40 repeat protein [F 99.9 1.4E-24 3E-29 169.2 18.1 214 101-317 22-294 (313)
35 KOG0318 WD40 repeat stress pro 99.9 5.7E-24 1.2E-28 180.6 23.3 244 99-346 59-330 (603)
36 KOG0265 U5 snRNP-specific prot 99.9 4.4E-24 9.6E-29 169.5 20.7 218 101-323 92-337 (338)
37 cd00200 WD40 WD40 domain, foun 99.9 1.5E-23 3.2E-28 178.3 25.3 216 100-345 10-228 (289)
38 KOG0319 WD40-repeat-containing 99.9 2.2E-24 4.7E-29 189.9 19.0 190 98-314 410-608 (775)
39 KOG0293 WD40 repeat-containing 99.9 2.2E-24 4.8E-29 178.1 17.8 245 74-323 217-510 (519)
40 KOG0313 Microtubule binding pr 99.9 7.9E-24 1.7E-28 173.1 20.7 241 93-342 99-395 (423)
41 KOG0973 Histone transcription 99.9 2E-24 4.3E-29 197.9 19.0 236 100-345 14-274 (942)
42 KOG0293 WD40 repeat-containing 99.9 2.9E-24 6.3E-29 177.4 18.1 212 99-336 224-437 (519)
43 KOG0277 Peroxisomal targeting 99.9 4.3E-24 9.3E-29 165.9 17.0 218 99-345 60-287 (311)
44 KOG0276 Vesicle coat complex C 99.9 6E-24 1.3E-28 184.0 19.7 187 99-314 55-246 (794)
45 KOG0316 Conserved WD40 repeat- 99.9 6.9E-24 1.5E-28 163.0 17.8 182 100-314 18-202 (307)
46 PTZ00420 coronin; Provisional 99.9 6.7E-23 1.4E-27 185.4 27.0 198 99-324 74-293 (568)
47 PLN00181 protein SPA1-RELATED; 99.9 7E-23 1.5E-27 197.8 28.0 199 98-324 482-690 (793)
48 KOG0283 WD40 repeat-containing 99.9 7.2E-24 1.6E-28 189.5 18.7 197 97-323 265-531 (712)
49 KOG0292 Vesicle coat complex C 99.9 2.3E-23 4.9E-28 186.9 21.6 248 73-326 43-323 (1202)
50 KOG0289 mRNA splicing factor [ 99.9 3.8E-23 8.3E-28 171.8 20.5 216 100-344 262-484 (506)
51 KOG0640 mRNA cleavage stimulat 99.9 1.3E-23 2.7E-28 167.8 16.3 202 99-326 112-335 (430)
52 KOG0643 Translation initiation 99.9 8.1E-23 1.8E-27 159.9 20.4 212 101-317 12-253 (327)
53 KOG0275 Conserved WD40 repeat- 99.9 3.3E-24 7.1E-29 172.2 12.7 200 101-328 215-425 (508)
54 KOG0292 Vesicle coat complex C 99.9 1.8E-23 3.9E-28 187.6 18.6 217 99-346 9-260 (1202)
55 KOG0772 Uncharacterized conser 99.9 1.6E-23 3.5E-28 177.6 16.4 216 100-330 168-400 (641)
56 KOG0305 Anaphase promoting com 99.9 8.2E-23 1.8E-27 178.0 21.0 216 99-344 217-439 (484)
57 KOG1332 Vesicle coat complex C 99.9 3.1E-23 6.7E-28 160.3 16.3 209 71-322 46-284 (299)
58 KOG1446 Histone H3 (Lys4) meth 99.9 1.4E-21 3.1E-26 156.6 25.4 215 99-314 14-294 (311)
59 cd00200 WD40 WD40 domain, foun 99.9 7.7E-22 1.7E-26 167.7 25.7 216 100-345 52-270 (289)
60 KOG2096 WD40 repeat protein [G 99.9 2.6E-22 5.6E-27 160.9 20.5 223 73-317 78-395 (420)
61 PTZ00421 coronin; Provisional 99.9 4.4E-22 9.5E-27 179.1 24.6 193 102-314 23-230 (493)
62 KOG0294 WD40 repeat-containing 99.9 8.9E-22 1.9E-26 157.5 22.4 198 99-328 43-285 (362)
63 PTZ00420 coronin; Provisional 99.9 1.2E-21 2.7E-26 177.2 25.9 176 117-315 50-234 (568)
64 KOG0276 Vesicle coat complex C 99.9 2.3E-22 4.9E-27 174.3 19.1 193 98-319 96-293 (794)
65 PLN00181 protein SPA1-RELATED; 99.9 1.5E-21 3.2E-26 188.6 27.1 191 100-322 533-736 (793)
66 KOG0281 Beta-TrCP (transducin 99.9 1.2E-23 2.7E-28 170.3 10.5 198 73-325 229-429 (499)
67 KOG0288 WD40 repeat protein Ti 99.9 9.7E-23 2.1E-27 168.4 15.9 210 101-314 221-450 (459)
68 KOG0269 WD40 repeat-containing 99.9 4.7E-23 1E-27 182.5 14.9 220 101-346 89-319 (839)
69 KOG0313 Microtubule binding pr 99.9 5.7E-22 1.2E-26 162.3 18.7 190 101-320 195-414 (423)
70 KOG0973 Histone transcription 99.9 1E-21 2.2E-26 180.3 22.3 227 99-327 69-356 (942)
71 KOG0264 Nucleosome remodeling 99.9 4.2E-22 9.1E-27 166.6 18.1 200 102-326 180-404 (422)
72 KOG0306 WD40-repeat-containing 99.9 5.9E-22 1.3E-26 175.0 19.9 225 101-344 414-642 (888)
73 KOG0275 Conserved WD40 repeat- 99.9 2.1E-22 4.4E-27 161.9 15.2 210 101-340 265-483 (508)
74 KOG0310 Conserved WD40 repeat- 99.9 6.9E-22 1.5E-26 166.6 18.9 192 101-323 70-267 (487)
75 KOG0647 mRNA export protein (c 99.9 7.3E-22 1.6E-26 157.1 17.9 214 99-315 27-313 (347)
76 KOG0310 Conserved WD40 repeat- 99.9 1.6E-21 3.5E-26 164.5 20.5 188 99-317 110-301 (487)
77 KOG0285 Pleiotropic regulator 99.9 3.5E-22 7.7E-27 162.4 15.6 191 102-324 196-389 (460)
78 KOG0289 mRNA splicing factor [ 99.9 2.2E-21 4.8E-26 161.4 19.5 194 101-324 221-419 (506)
79 KOG0283 WD40 repeat-containing 99.9 3E-21 6.4E-26 173.0 20.7 194 100-327 370-577 (712)
80 KOG0296 Angio-associated migra 99.9 6.9E-21 1.5E-25 155.2 20.9 187 98-314 63-252 (399)
81 KOG0306 WD40-repeat-containing 99.9 1.4E-21 3.1E-26 172.6 18.2 200 97-327 452-662 (888)
82 KOG0316 Conserved WD40 repeat- 99.9 4.2E-21 9E-26 147.9 18.0 214 101-318 61-293 (307)
83 KOG0772 Uncharacterized conser 99.9 1.6E-21 3.5E-26 165.5 16.7 217 74-314 160-428 (641)
84 KOG0640 mRNA cleavage stimulat 99.9 1.2E-21 2.7E-26 156.5 15.0 229 69-328 160-425 (430)
85 KOG2055 WD40 repeat protein [G 99.9 1.1E-20 2.3E-25 158.5 20.3 228 100-329 214-470 (514)
86 KOG0264 Nucleosome remodeling 99.9 6.6E-21 1.4E-25 159.5 18.5 208 99-326 124-347 (422)
87 KOG0277 Peroxisomal targeting 99.9 1.5E-20 3.2E-25 146.4 19.1 219 101-346 10-244 (311)
88 KOG0639 Transducin-like enhanc 99.9 2.5E-21 5.4E-26 164.0 13.7 199 99-326 465-663 (705)
89 KOG1332 Vesicle coat complex C 99.9 4.4E-21 9.6E-26 148.4 13.7 198 102-324 14-241 (299)
90 KOG0641 WD40 repeat protein [G 99.9 1.6E-19 3.4E-24 138.5 22.0 212 100-314 33-292 (350)
91 KOG0646 WD40 repeat protein [G 99.9 5.7E-20 1.2E-24 154.4 19.3 224 99-344 81-327 (476)
92 KOG0299 U3 snoRNP-associated p 99.9 2.7E-19 5.8E-24 150.1 23.1 225 97-327 200-457 (479)
93 KOG0281 Beta-TrCP (transducin 99.9 3.6E-21 7.7E-26 156.1 11.0 205 101-345 199-409 (499)
94 KOG0267 Microtubule severing p 99.9 9.6E-22 2.1E-26 173.0 8.3 187 98-314 69-257 (825)
95 KOG2106 Uncharacterized conser 99.9 3.8E-19 8.2E-24 150.9 22.8 235 101-345 248-500 (626)
96 KOG0268 Sof1-like rRNA process 99.9 7.2E-21 1.6E-25 155.0 11.6 228 71-324 56-302 (433)
97 KOG0305 Anaphase promoting com 99.8 1.3E-19 2.9E-24 158.1 19.9 198 99-328 260-463 (484)
98 KOG0269 WD40 repeat-containing 99.8 2.6E-20 5.6E-25 165.3 15.3 193 99-320 133-334 (839)
99 KOG0639 Transducin-like enhanc 99.8 2E-20 4.3E-25 158.5 13.6 193 101-324 511-704 (705)
100 KOG0302 Ribosome Assembly prot 99.8 1.6E-19 3.4E-24 148.0 18.1 200 102-326 154-380 (440)
101 KOG0308 Conserved WD40 repeat- 99.8 6E-20 1.3E-24 160.1 16.4 206 101-327 75-286 (735)
102 KOG1274 WD40 repeat protein [G 99.8 6E-19 1.3E-23 159.5 23.3 221 97-324 11-262 (933)
103 KOG0282 mRNA splicing factor [ 99.8 1.4E-20 3E-25 158.6 11.6 162 140-327 210-375 (503)
104 KOG0288 WD40 repeat protein Ti 99.8 2.1E-20 4.5E-25 154.7 12.3 223 99-327 175-418 (459)
105 KOG0301 Phospholipase A2-activ 99.8 1.3E-19 2.9E-24 159.0 17.8 187 101-326 103-290 (745)
106 KOG1539 WD repeat protein [Gen 99.8 2E-19 4.2E-24 161.0 19.0 196 100-325 449-647 (910)
107 KOG0278 Serine/threonine kinas 99.8 1E-20 2.3E-25 146.9 9.5 213 101-345 61-276 (334)
108 KOG1273 WD40 repeat protein [G 99.8 4.3E-19 9.4E-24 142.3 18.0 219 102-326 26-280 (405)
109 KOG0274 Cdc4 and related F-box 99.8 3.6E-19 7.9E-24 160.7 19.9 197 101-334 251-451 (537)
110 KOG4283 Transcription-coupled 99.8 3.1E-19 6.8E-24 141.9 16.7 213 84-326 27-276 (397)
111 KOG1036 Mitotic spindle checkp 99.8 6.3E-19 1.4E-23 141.0 18.2 209 99-315 13-294 (323)
112 KOG0308 Conserved WD40 repeat- 99.8 4.3E-20 9.4E-25 160.9 12.6 205 109-339 35-258 (735)
113 KOG0300 WD40 repeat-containing 99.8 1.7E-19 3.7E-24 144.8 14.9 221 100-327 149-387 (481)
114 KOG2445 Nuclear pore complex c 99.8 1.7E-18 3.7E-23 138.5 20.2 195 101-314 15-307 (361)
115 KOG0643 Translation initiation 99.8 9.5E-19 2.1E-23 137.3 18.1 215 73-314 44-306 (327)
116 KOG4378 Nuclear protein COP1 [ 99.8 1.7E-19 3.7E-24 152.7 14.9 218 101-346 81-303 (673)
117 KOG1274 WD40 repeat protein [G 99.8 1E-18 2.2E-23 158.0 20.8 212 77-313 70-288 (933)
118 KOG0267 Microtubule severing p 99.8 1.6E-20 3.5E-25 165.4 7.6 202 93-324 22-226 (825)
119 KOG1408 WD40 repeat protein [F 99.8 1.1E-18 2.3E-23 154.0 18.1 222 100-326 460-713 (1080)
120 KOG0641 WD40 repeat protein [G 99.8 1.9E-17 4.2E-22 127.1 22.6 222 99-322 89-347 (350)
121 KOG0300 WD40 repeat-containing 99.8 8.7E-19 1.9E-23 140.8 15.9 213 102-344 193-452 (481)
122 KOG0274 Cdc4 and related F-box 99.8 4.9E-18 1.1E-22 153.5 21.0 205 99-339 208-416 (537)
123 KOG0299 U3 snoRNP-associated p 99.8 4.9E-18 1.1E-22 142.6 18.5 204 98-330 141-360 (479)
124 KOG0302 Ribosome Assembly prot 99.8 2.2E-18 4.8E-23 141.3 15.2 188 101-313 213-426 (440)
125 KOG1063 RNA polymerase II elon 99.8 5.5E-18 1.2E-22 149.0 18.0 222 100-323 192-601 (764)
126 KOG0650 WD40 repeat nucleolar 99.8 7.3E-18 1.6E-22 146.0 18.3 239 100-344 401-658 (733)
127 KOG1446 Histone H3 (Lys4) meth 99.8 3.3E-17 7.1E-22 131.8 20.8 202 142-345 12-284 (311)
128 KOG1063 RNA polymerase II elon 99.8 1.6E-17 3.5E-22 146.0 20.5 248 74-323 260-647 (764)
129 KOG1407 WD40 repeat protein [F 99.8 1.2E-17 2.5E-22 130.9 16.7 173 141-314 17-250 (313)
130 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 1.6E-16 3.6E-21 136.6 24.9 197 101-329 74-282 (300)
131 KOG0303 Actin-binding protein 99.8 1.7E-17 3.6E-22 137.1 17.4 207 100-328 28-248 (472)
132 KOG0646 WD40 repeat protein [G 99.8 2E-17 4.2E-22 139.3 18.1 198 101-327 125-351 (476)
133 KOG0647 mRNA export protein (c 99.8 3.6E-17 7.8E-22 130.7 17.8 160 137-323 20-183 (347)
134 PRK03629 tolB translocation pr 99.8 3.1E-16 6.7E-21 140.9 26.0 215 101-347 200-428 (429)
135 PRK01742 tolB translocation pr 99.8 1.1E-16 2.4E-21 144.0 23.0 216 100-348 204-427 (429)
136 KOG0771 Prolactin regulatory e 99.8 1.6E-17 3.4E-22 138.4 15.9 196 103-326 148-356 (398)
137 PRK02889 tolB translocation pr 99.8 3.2E-16 7E-21 140.9 24.5 218 99-346 195-424 (427)
138 KOG0303 Actin-binding protein 99.8 1E-16 2.2E-21 132.5 19.3 204 99-330 81-298 (472)
139 KOG4328 WD40 protein [Function 99.8 3.8E-17 8.2E-22 137.3 17.0 201 99-324 186-399 (498)
140 KOG1007 WD repeat protein TSSC 99.8 1.3E-16 2.7E-21 126.9 18.8 190 101-317 125-352 (370)
141 KOG1009 Chromatin assembly com 99.8 1.2E-17 2.6E-22 138.3 13.3 204 99-313 13-248 (434)
142 TIGR03866 PQQ_ABC_repeats PQQ- 99.8 4.5E-16 9.7E-21 133.9 23.9 185 112-327 2-188 (300)
143 KOG0270 WD40 repeat-containing 99.8 9E-17 1.9E-21 134.6 18.2 192 111-329 192-407 (463)
144 KOG2048 WD40 repeat protein [G 99.8 2.4E-16 5.3E-21 138.4 21.6 208 101-339 27-248 (691)
145 PRK05137 tolB translocation pr 99.8 7.4E-16 1.6E-20 139.1 25.4 215 100-346 202-432 (435)
146 KOG0270 WD40 repeat-containing 99.8 1.3E-16 2.9E-21 133.6 18.6 203 98-329 242-452 (463)
147 KOG0321 WD40 repeat-containing 99.8 5.5E-17 1.2E-21 141.5 16.8 243 96-344 97-368 (720)
148 KOG2055 WD40 repeat protein [G 99.8 1.1E-16 2.3E-21 134.8 18.0 194 101-324 305-512 (514)
149 KOG0307 Vesicle coat complex C 99.8 1.4E-17 3E-22 154.2 13.7 203 99-327 116-330 (1049)
150 PRK04922 tolB translocation pr 99.8 5.5E-16 1.2E-20 139.8 23.9 214 100-345 204-431 (433)
151 KOG0301 Phospholipase A2-activ 99.7 1.1E-16 2.3E-21 141.0 18.3 205 102-314 17-238 (745)
152 KOG1408 WD40 repeat protein [F 99.7 5.6E-16 1.2E-20 137.1 22.7 242 101-345 326-692 (1080)
153 KOG0294 WD40 repeat-containing 99.7 5.5E-16 1.2E-20 124.7 19.1 183 114-325 4-198 (362)
154 KOG4328 WD40 protein [Function 99.7 7.4E-17 1.6E-21 135.6 14.7 189 99-314 234-439 (498)
155 KOG2096 WD40 repeat protein [G 99.7 2.5E-16 5.5E-21 126.8 17.1 182 141-325 83-309 (420)
156 KOG1034 Transcriptional repres 99.7 1.4E-16 3.1E-21 128.7 15.6 197 101-325 91-382 (385)
157 KOG1445 Tumor-specific antigen 99.7 6.2E-17 1.4E-21 141.3 14.6 207 96-330 624-848 (1012)
158 KOG1523 Actin-related protein 99.7 4.2E-16 9.1E-21 125.6 17.9 201 101-326 12-236 (361)
159 KOG4378 Nuclear protein COP1 [ 99.7 3.7E-16 8.1E-21 132.7 17.8 180 100-307 122-305 (673)
160 KOG1445 Tumor-specific antigen 99.7 6E-17 1.3E-21 141.4 13.3 188 106-314 586-783 (1012)
161 KOG0642 Cell-cycle nuclear pro 99.7 1.3E-16 2.8E-21 137.5 15.0 197 101-314 296-550 (577)
162 KOG0307 Vesicle coat complex C 99.7 4.6E-17 1E-21 150.8 13.1 204 99-327 64-285 (1049)
163 KOG0649 WD40 repeat protein [G 99.7 7.8E-16 1.7E-20 119.6 17.7 217 102-339 13-252 (325)
164 PF08662 eIF2A: Eukaryotic tra 99.7 1.1E-15 2.3E-20 121.7 19.3 153 103-286 9-181 (194)
165 KOG0268 Sof1-like rRNA process 99.7 7.6E-17 1.6E-21 131.8 12.5 144 145-316 188-336 (433)
166 KOG2106 Uncharacterized conser 99.7 4E-15 8.6E-20 126.8 20.8 194 97-326 285-518 (626)
167 KOG1007 WD repeat protein TSSC 99.7 1.2E-15 2.7E-20 121.3 16.4 199 101-323 65-286 (370)
168 KOG1538 Uncharacterized conser 99.7 1.6E-15 3.4E-20 133.4 18.7 218 101-323 14-292 (1081)
169 PRK11028 6-phosphogluconolacto 99.7 1.9E-14 4.2E-19 125.6 25.6 204 101-326 81-304 (330)
170 PRK11028 6-phosphogluconolacto 99.7 3.4E-14 7.3E-19 124.0 26.1 201 101-325 36-257 (330)
171 KOG2048 WD40 repeat protein [G 99.7 1.3E-14 2.9E-19 127.7 23.2 193 101-325 71-274 (691)
172 KOG1539 WD repeat protein [Gen 99.7 1.7E-14 3.7E-19 129.8 23.8 217 101-322 204-604 (910)
173 KOG2919 Guanine nucleotide-bin 99.7 4.6E-15 9.9E-20 119.9 18.2 202 102-326 52-281 (406)
174 KOG2445 Nuclear pore complex c 99.7 7.6E-15 1.7E-19 117.8 18.7 189 139-350 8-237 (361)
175 KOG0290 Conserved WD40 repeat- 99.7 5.4E-15 1.2E-19 117.8 17.6 197 101-320 152-361 (364)
176 PRK00178 tolB translocation pr 99.7 4.3E-14 9.3E-19 127.8 26.0 216 99-346 198-427 (430)
177 KOG2919 Guanine nucleotide-bin 99.7 3.4E-15 7.3E-20 120.6 16.4 189 101-316 160-361 (406)
178 PRK05137 tolB translocation pr 99.7 2.7E-14 5.9E-19 129.0 24.2 175 122-327 183-367 (435)
179 PRK01029 tolB translocation pr 99.7 3.3E-14 7.1E-19 127.4 24.3 217 101-346 186-424 (428)
180 PRK04792 tolB translocation pr 99.7 4E-14 8.8E-19 127.7 24.8 214 101-346 219-446 (448)
181 KOG2394 WD40 protein DMR-N9 [G 99.7 3.3E-15 7.1E-20 128.3 15.3 189 109-305 183-384 (636)
182 PRK03629 tolB translocation pr 99.7 7.4E-14 1.6E-18 125.5 24.2 176 122-328 180-365 (429)
183 KOG1188 WD40 repeat protein [G 99.7 2.4E-14 5.2E-19 116.5 18.5 189 112-327 41-245 (376)
184 TIGR02800 propeller_TolB tol-p 99.6 6.7E-14 1.5E-18 126.3 23.8 195 101-327 191-398 (417)
185 PF08662 eIF2A: Eukaryotic tra 99.6 4.4E-14 9.5E-19 112.5 19.8 99 213-315 60-163 (194)
186 KOG1310 WD40 repeat protein [G 99.6 5.4E-15 1.2E-19 127.3 15.1 217 73-327 42-304 (758)
187 KOG0321 WD40 repeat-containing 99.6 2E-14 4.4E-19 125.8 18.8 206 102-326 147-391 (720)
188 KOG0290 Conserved WD40 repeat- 99.6 2.8E-14 6.1E-19 113.8 17.1 229 101-348 46-299 (364)
189 KOG1036 Mitotic spindle checkp 99.6 4.8E-14 1E-18 113.3 17.9 157 141-328 10-167 (323)
190 KOG1273 WD40 repeat protein [G 99.6 1.9E-14 4.1E-19 116.0 15.0 151 147-324 26-226 (405)
191 KOG4283 Transcription-coupled 99.6 3.8E-14 8.2E-19 113.3 16.4 229 78-323 98-364 (397)
192 PRK04922 tolB translocation pr 99.6 1.3E-13 2.8E-18 124.4 22.3 176 122-328 185-370 (433)
193 KOG1524 WD40 repeat-containing 99.6 2.4E-14 5.2E-19 123.1 15.7 168 112-313 76-244 (737)
194 KOG2139 WD40 repeat protein [G 99.6 2.6E-13 5.5E-18 111.5 20.6 190 99-317 140-367 (445)
195 KOG2110 Uncharacterized conser 99.6 5.7E-13 1.2E-17 109.7 22.2 192 102-325 49-249 (391)
196 PRK01742 tolB translocation pr 99.6 4.2E-14 9.1E-19 127.4 16.9 172 102-306 250-426 (429)
197 KOG0322 G-protein beta subunit 99.6 4.7E-14 1E-18 111.0 14.7 217 100-321 15-320 (323)
198 PRK02889 tolB translocation pr 99.6 5.1E-13 1.1E-17 120.2 23.4 184 113-327 165-361 (427)
199 KOG1034 Transcriptional repres 99.6 3.6E-14 7.7E-19 115.0 13.6 185 96-284 132-383 (385)
200 KOG0649 WD40 repeat protein [G 99.6 6.3E-13 1.4E-17 103.6 19.7 197 101-322 116-312 (325)
201 KOG2111 Uncharacterized conser 99.6 1.5E-12 3.2E-17 105.4 22.4 174 121-325 75-257 (346)
202 PRK04043 tolB translocation pr 99.6 1.8E-12 3.9E-17 115.5 25.0 195 101-329 189-403 (419)
203 KOG1009 Chromatin assembly com 99.6 3.7E-14 8.1E-19 117.9 13.0 164 144-325 13-196 (434)
204 KOG1524 WD40 repeat-containing 99.6 6.6E-14 1.4E-18 120.4 14.6 174 100-317 105-278 (737)
205 PRK01029 tolB translocation pr 99.6 5.4E-13 1.2E-17 119.6 21.3 183 102-307 233-426 (428)
206 PRK00178 tolB translocation pr 99.6 2.1E-12 4.7E-17 116.8 24.1 175 123-328 181-365 (430)
207 KOG0650 WD40 repeat nucleolar 99.6 7E-14 1.5E-18 121.7 13.5 191 100-321 522-732 (733)
208 TIGR02800 propeller_TolB tol-p 99.6 1.5E-12 3.2E-17 117.6 22.9 176 122-328 171-356 (417)
209 KOG1963 WD40 repeat protein [G 99.6 5.4E-13 1.2E-17 121.1 19.1 227 96-325 202-539 (792)
210 KOG4227 WD40 repeat protein [G 99.5 2.5E-13 5.3E-18 112.7 15.2 188 101-313 58-262 (609)
211 PRK04792 tolB translocation pr 99.5 2.3E-12 5E-17 116.4 22.8 176 122-328 199-384 (448)
212 KOG1523 Actin-related protein 99.5 4.9E-13 1.1E-17 108.1 15.7 191 99-313 55-267 (361)
213 KOG1587 Cytoplasmic dynein int 99.5 2.9E-12 6.2E-17 115.6 21.9 214 99-327 242-473 (555)
214 KOG4497 Uncharacterized conser 99.5 3.5E-13 7.5E-18 109.5 13.9 179 105-314 14-229 (447)
215 KOG0771 Prolactin regulatory e 99.5 1.8E-13 3.9E-18 114.4 12.3 173 148-348 148-336 (398)
216 PF10282 Lactonase: Lactonase, 99.5 7E-11 1.5E-15 103.4 29.1 208 99-328 86-324 (345)
217 KOG2394 WD40 protein DMR-N9 [G 99.5 4.7E-13 1E-17 115.2 14.0 137 99-263 219-383 (636)
218 KOG0644 Uncharacterized conser 99.5 1.2E-13 2.5E-18 124.6 9.4 198 99-330 190-430 (1113)
219 COG2319 FOG: WD40 repeat [Gene 99.5 2.3E-11 5E-16 109.1 24.2 195 101-326 111-314 (466)
220 KOG2110 Uncharacterized conser 99.5 4.8E-12 1E-16 104.3 17.6 154 101-285 89-249 (391)
221 KOG0322 G-protein beta subunit 99.5 1.3E-12 2.7E-17 103.1 12.2 170 91-283 142-322 (323)
222 COG2706 3-carboxymuconate cycl 99.5 1.9E-10 4.2E-15 95.2 25.2 212 100-328 40-276 (346)
223 KOG1272 WD40-repeat-containing 99.5 3.1E-13 6.7E-18 114.4 9.0 198 99-330 129-329 (545)
224 KOG0642 Cell-cycle nuclear pro 99.4 5.1E-12 1.1E-16 109.5 15.9 187 100-288 345-565 (577)
225 KOG4497 Uncharacterized conser 99.4 2.1E-11 4.6E-16 99.3 18.3 221 102-327 51-392 (447)
226 KOG1963 WD40 repeat protein [G 99.4 1.2E-11 2.6E-16 112.5 18.6 217 105-327 22-323 (792)
227 COG2319 FOG: WD40 repeat [Gene 99.4 1E-10 2.2E-15 105.0 24.9 200 98-325 64-272 (466)
228 KOG1272 WD40-repeat-containing 99.4 2.7E-13 5.8E-18 114.7 7.1 187 101-322 172-360 (545)
229 KOG4547 WD40 repeat-containing 99.4 4.2E-11 9.1E-16 104.6 19.3 191 109-328 3-224 (541)
230 KOG1517 Guanine nucleotide bin 99.4 1E-11 2.2E-16 115.1 16.0 186 103-314 1169-1370(1387)
231 PF02239 Cytochrom_D1: Cytochr 99.4 1.5E-10 3.2E-15 101.4 22.7 218 103-326 40-347 (369)
232 COG2706 3-carboxymuconate cycl 99.4 1.2E-09 2.6E-14 90.5 25.3 205 99-327 88-322 (346)
233 KOG1538 Uncharacterized conser 99.4 1.7E-11 3.6E-16 108.6 15.2 195 71-285 43-294 (1081)
234 PF10282 Lactonase: Lactonase, 99.4 1.2E-09 2.5E-14 95.7 26.2 213 101-326 38-275 (345)
235 KOG3881 Uncharacterized conser 99.4 6.6E-11 1.4E-15 98.4 17.0 194 112-325 116-321 (412)
236 KOG1188 WD40 repeat protein [G 99.4 1.4E-10 3.1E-15 94.9 18.3 161 101-288 72-246 (376)
237 KOG1354 Serine/threonine prote 99.3 5E-11 1.1E-15 97.6 15.2 234 100-335 26-313 (433)
238 PF02239 Cytochrom_D1: Cytochr 99.3 4.3E-10 9.3E-15 98.6 22.2 187 112-328 6-204 (369)
239 KOG2111 Uncharacterized conser 99.3 1.4E-09 3E-14 88.4 22.9 158 101-286 96-258 (346)
240 KOG0644 Uncharacterized conser 99.3 4.7E-12 1E-16 114.5 9.6 214 102-326 235-468 (1113)
241 KOG4227 WD40 repeat protein [G 99.3 4.6E-11 9.9E-16 99.5 14.1 168 142-329 54-230 (609)
242 KOG1517 Guanine nucleotide bin 99.3 3.1E-10 6.8E-15 105.5 19.9 205 101-326 1066-1289(1387)
243 KOG1587 Cytoplasmic dynein int 99.3 4.5E-10 9.8E-15 101.6 20.3 207 99-325 291-515 (555)
244 PRK04043 tolB translocation pr 99.3 3.3E-09 7.2E-14 94.7 24.7 173 122-328 170-359 (419)
245 KOG3881 Uncharacterized conser 99.3 2.1E-10 4.5E-15 95.5 15.5 181 99-307 148-343 (412)
246 COG4946 Uncharacterized protei 99.3 8.4E-10 1.8E-14 94.3 19.4 171 110-314 331-507 (668)
247 KOG1240 Protein kinase contain 99.3 1.6E-09 3.4E-14 102.4 21.4 207 100-325 1049-1272(1431)
248 KOG2321 WD40 repeat protein [G 99.2 1.2E-09 2.5E-14 95.5 17.6 93 213-306 176-282 (703)
249 KOG0974 WD-repeat protein WDR6 99.2 2.3E-10 4.9E-15 106.2 13.2 154 102-286 136-290 (967)
250 KOG1354 Serine/threonine prote 99.2 5.5E-10 1.2E-14 91.7 13.5 207 98-321 163-431 (433)
251 TIGR02658 TTQ_MADH_Hv methylam 99.2 3.1E-08 6.8E-13 85.1 24.8 217 107-328 53-332 (352)
252 KOG2321 WD40 repeat protein [G 99.2 1.2E-09 2.6E-14 95.4 15.9 191 103-316 137-334 (703)
253 KOG1334 WD40 repeat protein [G 99.2 5.9E-10 1.3E-14 95.4 12.4 221 100-327 143-464 (559)
254 KOG0974 WD-repeat protein WDR6 99.1 3E-09 6.6E-14 98.9 16.9 177 105-314 93-277 (967)
255 KOG2315 Predicted translation 99.1 7.6E-09 1.7E-13 90.2 17.5 169 103-306 221-411 (566)
256 KOG1240 Protein kinase contain 99.1 4.3E-09 9.3E-14 99.6 16.4 196 133-349 1038-1251(1431)
257 KOG4532 WD40-like repeat conta 99.1 3E-08 6.4E-13 79.1 18.5 186 114-328 131-333 (344)
258 PF15492 Nbas_N: Neuroblastoma 99.1 4.2E-08 9.2E-13 79.2 19.6 168 101-289 45-264 (282)
259 KOG2315 Predicted translation 99.1 6E-08 1.3E-12 84.8 21.4 202 96-328 162-392 (566)
260 KOG2041 WD40 repeat protein [G 99.1 2.8E-08 6E-13 89.4 19.6 225 99-324 14-337 (1189)
261 PLN02919 haloacid dehalogenase 99.1 1.9E-07 4E-12 92.7 26.7 211 102-328 626-890 (1057)
262 KOG1310 WD40 repeat protein [G 99.0 1.5E-09 3.2E-14 94.4 10.3 157 141-323 47-230 (758)
263 KOG1064 RAVE (regulator of V-A 99.0 1.8E-09 3.9E-14 105.6 11.7 172 101-289 2210-2403(2439)
264 COG4946 Uncharacterized protei 99.0 6.7E-08 1.4E-12 83.0 19.6 192 106-326 273-474 (668)
265 KOG2314 Translation initiation 99.0 5.5E-08 1.2E-12 85.0 18.8 100 214-314 447-556 (698)
266 KOG0280 Uncharacterized conser 99.0 1.8E-08 3.8E-13 81.3 14.0 187 101-314 123-320 (339)
267 KOG3914 WD repeat protein WDR4 99.0 1.9E-08 4.1E-13 84.5 14.6 158 101-288 64-227 (390)
268 COG5170 CDC55 Serine/threonine 99.0 1.4E-08 3E-13 82.6 12.9 227 100-330 27-315 (460)
269 COG0823 TolB Periplasmic compo 99.0 4.3E-08 9.3E-13 87.1 16.5 197 101-328 194-404 (425)
270 PF04762 IKI3: IKI3 family; I 98.9 6.5E-07 1.4E-11 87.3 24.5 224 97-323 73-332 (928)
271 COG0823 TolB Periplasmic compo 98.9 1.2E-07 2.7E-12 84.2 16.9 145 143-314 191-344 (425)
272 KOG0280 Uncharacterized conser 98.9 2.3E-07 5E-12 75.0 16.7 180 101-307 71-265 (339)
273 KOG4532 WD40-like repeat conta 98.9 1E-06 2.2E-11 70.5 19.1 186 112-327 85-283 (344)
274 KOG4547 WD40 repeat-containing 98.8 9E-08 2E-12 84.2 12.7 180 156-347 5-195 (541)
275 PLN02919 haloacid dehalogenase 98.8 1E-06 2.3E-11 87.4 21.0 178 102-288 685-892 (1057)
276 KOG4190 Uncharacterized conser 98.8 3.8E-08 8.3E-13 86.0 9.2 154 109-289 745-911 (1034)
277 PF15492 Nbas_N: Neuroblastoma 98.8 5.6E-06 1.2E-10 67.2 20.7 197 105-323 3-258 (282)
278 TIGR02658 TTQ_MADH_Hv methylam 98.8 7.1E-06 1.5E-10 70.8 22.5 209 81-291 86-337 (352)
279 KOG1409 Uncharacterized conser 98.8 5.5E-07 1.2E-11 74.4 14.9 234 73-325 16-271 (404)
280 PF08450 SGL: SMP-30/Gluconola 98.7 6.4E-06 1.4E-10 68.7 21.6 184 102-314 42-244 (246)
281 COG5354 Uncharacterized protei 98.7 2.3E-06 4.9E-11 74.4 16.4 171 103-313 226-417 (561)
282 PF04762 IKI3: IKI3 family; I 98.6 1.5E-05 3.3E-10 78.0 23.6 195 100-322 121-377 (928)
283 KOG2314 Translation initiation 98.6 3.1E-06 6.7E-11 74.4 16.3 182 102-314 213-412 (698)
284 KOG0309 Conserved WD40 repeat- 98.6 2.6E-07 5.5E-12 83.6 9.6 185 100-311 68-261 (1081)
285 KOG1334 WD40 repeat protein [G 98.6 2.7E-07 5.8E-12 79.5 9.4 174 101-287 283-469 (559)
286 PF08450 SGL: SMP-30/Gluconola 98.6 0.00015 3.2E-09 60.5 25.5 191 104-327 4-214 (246)
287 KOG0309 Conserved WD40 repeat- 98.6 1.6E-07 3.4E-12 84.9 7.9 179 100-306 115-310 (1081)
288 KOG1409 Uncharacterized conser 98.5 5E-06 1.1E-10 68.9 14.8 187 99-287 68-273 (404)
289 KOG2066 Vacuolar assembly/sort 98.5 1.5E-05 3.1E-10 73.3 19.0 178 101-324 41-233 (846)
290 COG5354 Uncharacterized protei 98.5 3.4E-05 7.4E-10 67.3 20.0 208 100-314 72-334 (561)
291 KOG3914 WD repeat protein WDR4 98.5 4.1E-06 9E-11 70.7 13.6 112 214-327 109-224 (390)
292 PF00400 WD40: WD domain, G-be 98.5 5.8E-07 1.3E-11 51.2 6.0 38 202-241 2-39 (39)
293 PF14583 Pectate_lyase22: Olig 98.5 0.00014 3E-09 62.8 22.3 111 216-327 241-384 (386)
294 KOG0882 Cyclophilin-related pe 98.5 2.2E-06 4.9E-11 73.4 11.3 215 110-325 19-306 (558)
295 PF07433 DUF1513: Protein of u 98.5 0.00021 4.5E-09 59.9 22.7 199 102-327 7-248 (305)
296 KOG1920 IkappaB kinase complex 98.5 4.5E-05 9.7E-10 73.3 21.0 207 100-312 69-306 (1265)
297 KOG2041 WD40 repeat protein [G 98.5 1.3E-06 2.7E-11 79.1 10.3 159 142-314 12-175 (1189)
298 KOG1645 RING-finger-containing 98.5 1.5E-05 3.2E-10 67.6 15.7 221 99-323 193-460 (463)
299 KOG4714 Nucleoporin [Nuclear s 98.5 3.7E-06 7.9E-11 67.1 11.3 72 214-285 181-255 (319)
300 PF00400 WD40: WD domain, G-be 98.4 1E-06 2.2E-11 50.1 6.1 34 249-282 6-39 (39)
301 PRK02888 nitrous-oxide reducta 98.4 2.5E-05 5.5E-10 71.3 16.8 102 213-314 321-450 (635)
302 PF00930 DPPIV_N: Dipeptidyl p 98.4 0.00022 4.8E-09 62.9 22.0 100 217-316 239-348 (353)
303 KOG2114 Vacuolar assembly/sort 98.4 0.0001 2.2E-09 68.5 20.0 198 106-322 30-241 (933)
304 PF07433 DUF1513: Protein of u 98.4 0.00031 6.8E-09 58.8 21.3 192 105-314 56-275 (305)
305 KOG1832 HIV-1 Vpr-binding prot 98.4 5.5E-07 1.2E-11 83.2 5.6 183 101-326 1103-1293(1516)
306 KOG2695 WD40 repeat protein [G 98.4 2.3E-06 4.9E-11 71.0 8.5 175 101-304 213-401 (425)
307 KOG2695 WD40 repeat protein [G 98.3 2.5E-06 5.4E-11 70.7 8.4 132 96-252 249-385 (425)
308 PF06977 SdiA-regulated: SdiA- 98.3 0.00063 1.4E-08 56.1 22.0 191 101-313 23-239 (248)
309 COG5170 CDC55 Serine/threonine 98.3 6.6E-06 1.4E-10 67.4 9.7 171 97-283 170-366 (460)
310 PF11768 DUF3312: Protein of u 98.3 0.0013 2.8E-08 59.1 24.5 124 200-326 195-331 (545)
311 PRK13616 lipoprotein LpqB; Pro 98.3 7.3E-05 1.6E-09 69.7 17.5 156 145-330 350-531 (591)
312 KOG1064 RAVE (regulator of V-A 98.3 6.5E-06 1.4E-10 81.8 10.2 154 142-323 2206-2365(2439)
313 KOG1008 Uncharacterized conser 98.2 9.4E-07 2E-11 78.9 4.2 202 101-326 58-275 (783)
314 PF00930 DPPIV_N: Dipeptidyl p 98.2 0.00037 8E-09 61.4 19.9 223 100-326 43-315 (353)
315 PF11768 DUF3312: Protein of u 98.2 0.00064 1.4E-08 61.0 20.8 94 212-307 259-369 (545)
316 COG3391 Uncharacterized conser 98.2 0.0012 2.6E-08 58.8 22.4 194 102-327 76-284 (381)
317 PF04053 Coatomer_WDAD: Coatom 98.1 0.00017 3.8E-09 64.7 16.2 161 101-306 34-207 (443)
318 KOG3621 WD40 repeat-containing 98.1 0.00016 3.4E-09 65.9 14.6 199 102-327 36-247 (726)
319 KOG1912 WD40 repeat protein [G 98.1 0.00016 3.5E-09 66.5 14.8 169 143-341 14-202 (1062)
320 KOG4190 Uncharacterized conser 98.0 2.2E-05 4.9E-10 69.2 8.1 154 141-316 732-897 (1034)
321 KOG1920 IkappaB kinase complex 98.0 0.00079 1.7E-08 65.2 18.8 159 100-287 110-325 (1265)
322 PF04841 Vps16_N: Vps16, N-ter 98.0 0.0045 9.7E-08 55.6 22.7 192 105-308 34-272 (410)
323 KOG4714 Nucleoporin [Nuclear s 98.0 3.4E-05 7.3E-10 61.8 7.7 72 101-174 181-254 (319)
324 COG3391 Uncharacterized conser 98.0 0.0095 2.1E-07 53.1 23.8 194 102-327 33-240 (381)
325 PRK13616 lipoprotein LpqB; Pro 97.9 0.0029 6.2E-08 59.3 20.7 187 100-313 350-556 (591)
326 KOG1275 PAB-dependent poly(A) 97.9 0.00015 3.2E-09 67.9 11.9 141 109-282 185-340 (1118)
327 PRK02888 nitrous-oxide reducta 97.9 0.00055 1.2E-08 62.9 15.2 111 214-329 236-354 (635)
328 KOG1275 PAB-dependent poly(A) 97.9 0.00061 1.3E-08 64.0 15.4 171 111-314 147-331 (1118)
329 PF04053 Coatomer_WDAD: Coatom 97.9 0.00083 1.8E-08 60.4 15.8 143 144-326 32-175 (443)
330 PF06433 Me-amine-dh_H: Methyl 97.9 0.0074 1.6E-07 51.5 20.2 198 89-292 84-328 (342)
331 KOG1912 WD40 repeat protein [G 97.9 0.00059 1.3E-08 63.0 14.5 151 101-283 17-185 (1062)
332 KOG2066 Vacuolar assembly/sort 97.9 0.00041 8.9E-09 64.2 13.2 143 145-327 40-190 (846)
333 PF13360 PQQ_2: PQQ-like domai 97.8 0.012 2.6E-07 48.6 21.4 186 110-328 35-232 (238)
334 PF02897 Peptidase_S9_N: Proly 97.8 0.019 4.1E-07 51.9 23.6 198 102-326 126-357 (414)
335 KOG3617 WD40 and TPR repeat-co 97.8 0.00038 8.3E-09 64.8 12.2 76 99-177 59-134 (1416)
336 KOG4640 Anaphase-promoting com 97.8 0.00016 3.5E-09 65.0 9.1 91 213-305 21-115 (665)
337 PF06433 Me-amine-dh_H: Methyl 97.7 0.01 2.2E-07 50.7 19.0 225 102-327 38-321 (342)
338 KOG3621 WD40 repeat-containing 97.7 0.0003 6.6E-09 64.1 10.0 113 213-327 34-155 (726)
339 KOG1645 RING-finger-containing 97.6 0.00089 1.9E-08 57.1 10.6 147 139-314 188-349 (463)
340 TIGR03300 assembly_YfgL outer 97.6 0.0052 1.1E-07 54.8 16.2 142 112-290 191-344 (377)
341 COG3386 Gluconolactonase [Carb 97.6 0.024 5.1E-07 48.6 19.2 103 214-317 164-277 (307)
342 PF10647 Gmad1: Lipoprotein Lp 97.6 0.026 5.7E-07 47.1 19.1 153 146-326 25-197 (253)
343 PF08553 VID27: VID27 cytoplas 97.5 0.0066 1.4E-07 58.0 16.3 97 227-325 545-648 (794)
344 KOG1008 Uncharacterized conser 97.5 3.4E-05 7.3E-10 69.3 0.7 156 101-285 104-276 (783)
345 PF13360 PQQ_2: PQQ-like domai 97.5 0.024 5.2E-07 46.8 17.9 137 120-289 2-145 (238)
346 TIGR03300 assembly_YfgL outer 97.5 0.059 1.3E-06 48.1 21.5 205 110-326 104-338 (377)
347 KOG3617 WD40 and TPR repeat-co 97.5 0.00041 8.8E-09 64.7 7.4 111 214-325 17-132 (1416)
348 PF14783 BBS2_Mid: Ciliary BBS 97.4 0.022 4.7E-07 40.1 13.9 66 102-174 2-71 (111)
349 KOG0882 Cyclophilin-related pe 97.4 0.0044 9.6E-08 53.8 12.4 163 113-289 113-310 (558)
350 KOG1832 HIV-1 Vpr-binding prot 97.4 0.00042 9.2E-09 64.9 6.7 154 141-327 1098-1258(1516)
351 PF10647 Gmad1: Lipoprotein Lp 97.4 0.065 1.4E-06 44.8 21.2 188 100-313 24-226 (253)
352 PF02897 Peptidase_S9_N: Proly 97.3 0.0092 2E-07 54.0 14.4 114 215-328 126-262 (414)
353 PF08553 VID27: VID27 cytoplas 97.3 0.016 3.4E-07 55.6 15.7 138 120-283 503-646 (794)
354 KOG4640 Anaphase-promoting com 97.3 0.0022 4.7E-08 58.1 9.4 78 98-179 19-97 (665)
355 PF15390 DUF4613: Domain of un 97.2 0.12 2.6E-06 47.2 19.9 182 101-313 21-219 (671)
356 KOG2114 Vacuolar assembly/sort 97.2 0.09 2E-06 49.8 19.7 153 112-288 78-247 (933)
357 smart00320 WD40 WD40 repeats. 97.1 0.0017 3.8E-08 35.5 5.1 32 251-282 9-40 (40)
358 TIGR02604 Piru_Ver_Nterm putat 97.1 0.082 1.8E-06 46.9 17.6 153 101-273 15-202 (367)
359 KOG2395 Protein involved in va 97.1 0.024 5.1E-07 50.7 13.6 108 215-325 378-501 (644)
360 PF08596 Lgl_C: Lethal giant l 97.0 0.18 4E-06 44.9 19.1 89 236-327 236-336 (395)
361 COG3490 Uncharacterized protei 97.0 0.16 3.5E-06 42.0 17.0 144 146-313 69-243 (366)
362 KOG4649 PQQ (pyrrolo-quinoline 96.9 0.18 3.9E-06 41.2 19.6 71 110-184 62-133 (354)
363 PF14783 BBS2_Mid: Ciliary BBS 96.9 0.085 1.8E-06 37.2 14.7 100 147-279 2-109 (111)
364 PF00780 CNH: CNH domain; Int 96.8 0.24 5.3E-06 41.9 20.7 161 110-292 6-173 (275)
365 smart00320 WD40 WD40 repeats. 96.8 0.0042 9E-08 33.9 5.1 34 206-241 7-40 (40)
366 PF06977 SdiA-regulated: SdiA- 96.8 0.1 2.2E-06 43.2 14.9 160 142-328 19-203 (248)
367 PF03178 CPSF_A: CPSF A subuni 96.8 0.24 5.2E-06 43.1 18.2 110 213-327 89-203 (321)
368 PF12234 Rav1p_C: RAVE protein 96.8 0.074 1.6E-06 49.8 15.4 99 214-313 31-146 (631)
369 COG3204 Uncharacterized protei 96.8 0.24 5.3E-06 41.3 18.7 195 100-313 86-301 (316)
370 PF12894 Apc4_WD40: Anaphase-p 96.8 0.0047 1E-07 36.3 4.9 29 101-129 13-41 (47)
371 PF03178 CPSF_A: CPSF A subuni 96.7 0.36 7.7E-06 42.0 19.6 144 111-284 42-202 (321)
372 KOG4649 PQQ (pyrrolo-quinoline 96.6 0.16 3.5E-06 41.4 13.8 86 224-310 63-151 (354)
373 PF15390 DUF4613: Domain of un 96.5 0.15 3.3E-06 46.5 14.4 115 213-328 57-188 (671)
374 PF12894 Apc4_WD40: Anaphase-p 96.5 0.015 3.2E-07 34.2 5.6 31 254-284 11-41 (47)
375 COG3490 Uncharacterized protei 96.4 0.25 5.5E-06 41.0 13.9 103 213-315 68-181 (366)
376 TIGR02604 Piru_Ver_Nterm putat 96.4 0.26 5.7E-06 43.7 15.7 97 214-314 73-202 (367)
377 PRK11138 outer membrane biogen 96.4 0.33 7.1E-06 43.6 16.5 64 223-289 293-358 (394)
378 COG3386 Gluconolactonase [Carb 96.4 0.57 1.2E-05 40.3 20.1 180 105-313 30-230 (307)
379 KOG2079 Vacuolar assembly/sort 96.3 0.018 3.9E-07 55.6 8.3 102 224-327 99-206 (1206)
380 COG3204 Uncharacterized protei 96.2 0.6 1.3E-05 39.0 15.6 162 142-329 83-266 (316)
381 PF12234 Rav1p_C: RAVE protein 96.2 0.17 3.6E-06 47.5 13.5 118 105-243 35-156 (631)
382 PF05096 Glu_cyclase_2: Glutam 96.1 0.66 1.4E-05 38.5 24.7 190 102-326 47-261 (264)
383 PF00780 CNH: CNH domain; Int 96.0 0.64 1.4E-05 39.3 15.8 138 155-324 6-165 (275)
384 PRK10115 protease 2; Provision 96.0 1.7 3.6E-05 42.2 25.5 194 101-326 128-346 (686)
385 PRK11138 outer membrane biogen 95.9 0.71 1.5E-05 41.5 16.3 136 111-283 256-393 (394)
386 KOG2444 WD40 repeat protein [G 95.8 0.023 5E-07 45.2 5.3 139 116-285 35-178 (238)
387 PF07995 GSDH: Glucose / Sorbo 95.7 1.3 2.7E-05 38.8 16.5 52 102-155 4-59 (331)
388 PF08596 Lgl_C: Lethal giant l 95.7 0.64 1.4E-05 41.6 14.7 136 146-284 3-173 (395)
389 PF14583 Pectate_lyase22: Olig 95.6 0.68 1.5E-05 40.7 14.0 171 131-328 18-226 (386)
390 KOG2247 WD40 repeat-containing 95.6 0.0021 4.6E-08 56.5 -1.1 145 143-315 33-179 (615)
391 cd00216 PQQ_DH Dehydrogenases 95.6 1.4 3.1E-05 40.8 17.1 79 235-313 366-455 (488)
392 KOG2395 Protein involved in va 95.5 0.5 1.1E-05 42.7 13.0 136 121-284 356-500 (644)
393 PF05694 SBP56: 56kDa selenium 95.5 0.82 1.8E-05 40.7 14.1 222 102-340 183-451 (461)
394 KOG2280 Vacuolar assembly/sort 95.3 1.3 2.8E-05 41.9 15.5 49 121-174 64-112 (829)
395 KOG2377 Uncharacterized conser 95.3 0.59 1.3E-05 41.5 12.6 101 212-315 66-173 (657)
396 PF07569 Hira: TUP1-like enhan 95.3 0.18 4E-06 41.0 9.2 64 262-325 18-96 (219)
397 PF14727 PHTB1_N: PTHB1 N-term 95.2 2.2 4.8E-05 38.3 16.6 157 111-283 37-203 (418)
398 KOG2444 WD40 repeat protein [G 95.2 0.084 1.8E-06 42.2 6.6 106 111-244 70-178 (238)
399 PRK10115 protease 2; Provision 95.2 1.1 2.4E-05 43.4 15.5 110 214-324 128-253 (686)
400 KOG2079 Vacuolar assembly/sort 95.2 0.17 3.8E-06 49.3 9.7 65 212-277 130-198 (1206)
401 PF10313 DUF2415: Uncharacteri 95.0 0.12 2.6E-06 29.4 5.1 31 255-285 1-34 (43)
402 KOG2377 Uncharacterized conser 94.8 2.8 6E-05 37.5 16.8 161 103-289 26-190 (657)
403 PF05694 SBP56: 56kDa selenium 94.8 2.9 6.2E-05 37.4 16.2 185 103-314 133-392 (461)
404 PF10313 DUF2415: Uncharacteri 94.7 0.14 3E-06 29.2 4.8 31 145-175 1-34 (43)
405 TIGR03606 non_repeat_PQQ dehyd 94.7 3.3 7.2E-05 37.7 18.3 54 102-155 32-89 (454)
406 KOG2247 WD40 repeat-containing 94.6 0.0065 1.4E-07 53.6 -0.9 135 104-270 39-175 (615)
407 PF14870 PSII_BNR: Photosynthe 94.6 2.6 5.6E-05 36.1 17.9 167 117-317 120-297 (302)
408 KOG4499 Ca2+-binding protein R 94.6 2.1 4.5E-05 34.8 13.6 142 101-264 110-263 (310)
409 PF10168 Nup88: Nuclear pore c 94.5 1.7 3.7E-05 42.1 14.5 73 213-287 85-182 (717)
410 PF14870 PSII_BNR: Photosynthe 94.5 2.8 6.1E-05 35.9 21.9 102 213-316 145-253 (302)
411 KOG3630 Nuclear pore complex, 94.4 0.95 2.1E-05 44.8 12.6 101 213-314 156-262 (1405)
412 PF14761 HPS3_N: Hermansky-Pud 94.1 2.5 5.4E-05 33.9 15.7 162 112-283 29-213 (215)
413 KOG3630 Nuclear pore complex, 94.0 0.46 9.9E-06 46.9 9.6 146 99-271 100-260 (1405)
414 COG5167 VID27 Protein involved 93.9 2.4 5.1E-05 38.5 13.1 62 265-326 572-634 (776)
415 PF08728 CRT10: CRT10; InterP 93.8 6.7 0.00014 37.7 17.2 110 214-325 102-245 (717)
416 PF07569 Hira: TUP1-like enhan 93.8 0.53 1.1E-05 38.3 8.5 67 220-288 18-99 (219)
417 PF10168 Nup88: Nuclear pore c 93.8 0.86 1.9E-05 44.1 11.1 85 99-184 84-189 (717)
418 PF04841 Vps16_N: Vps16, N-ter 93.7 5.1 0.00011 36.2 21.2 68 213-283 217-286 (410)
419 TIGR02276 beta_rpt_yvtn 40-res 93.7 0.44 9.6E-06 26.8 5.9 41 222-262 1-41 (42)
420 COG4590 ABC-type uncharacteriz 93.1 0.89 1.9E-05 40.4 9.1 164 100-288 221-390 (733)
421 PRK13684 Ycf48-like protein; P 92.8 6.3 0.00014 34.5 17.1 152 101-282 174-329 (334)
422 KOG4441 Proteins containing BT 92.7 9.3 0.0002 36.2 17.0 152 109-290 283-458 (571)
423 PF07676 PD40: WD40-like Beta 92.6 0.61 1.3E-05 25.9 5.2 28 213-240 9-38 (39)
424 PF13449 Phytase-like: Esteras 92.5 6.8 0.00015 34.2 18.4 173 144-328 19-253 (326)
425 PF03088 Str_synth: Strictosid 92.5 1.5 3.3E-05 29.7 7.8 51 273-323 34-84 (89)
426 PF07676 PD40: WD40-like Beta 92.5 0.65 1.4E-05 25.7 5.2 24 292-315 5-28 (39)
427 PF03088 Str_synth: Strictosid 92.3 1.9 4.1E-05 29.3 8.1 39 235-273 37-75 (89)
428 TIGR03606 non_repeat_PQQ dehyd 92.2 6.5 0.00014 35.9 13.8 103 213-316 30-166 (454)
429 PF07995 GSDH: Glucose / Sorbo 92.2 2.9 6.3E-05 36.5 11.5 98 214-314 3-132 (331)
430 KOG2280 Vacuolar assembly/sort 92.2 11 0.00024 36.1 16.3 95 213-313 217-313 (829)
431 PF10395 Utp8: Utp8 family; I 92.1 11 0.00025 35.8 21.3 32 143-174 128-159 (670)
432 PF05096 Glu_cyclase_2: Glutam 91.8 6.8 0.00015 32.7 13.7 117 143-288 43-161 (264)
433 TIGR02276 beta_rpt_yvtn 40-res 91.7 0.93 2E-05 25.4 5.5 40 264-303 1-41 (42)
434 PF10214 Rrn6: RNA polymerase 91.6 15 0.00033 36.4 21.2 153 142-306 77-257 (765)
435 PF14781 BBS2_N: Ciliary BBSom 91.4 4.4 9.6E-05 29.8 12.7 63 224-288 64-129 (136)
436 TIGR02171 Fb_sc_TIGR02171 Fibr 91.3 2 4.3E-05 42.0 9.9 87 226-312 320-415 (912)
437 PRK13684 Ycf48-like protein; P 91.2 9.8 0.00021 33.3 20.5 146 142-317 170-324 (334)
438 COG1506 DAP2 Dipeptidyl aminop 91.0 8.5 0.00018 37.0 14.1 168 98-314 58-234 (620)
439 PHA02713 hypothetical protein; 90.8 5.8 0.00013 37.6 12.5 65 223-289 463-538 (557)
440 PLN00033 photosystem II stabil 90.6 12 0.00027 33.5 18.0 150 102-281 241-396 (398)
441 KOG1916 Nuclear protein, conta 90.5 0.38 8.2E-06 46.3 4.4 71 101-175 182-266 (1283)
442 PF11635 Med16: Mediator compl 90.0 21 0.00046 35.3 17.6 76 201-279 250-345 (753)
443 PF14761 HPS3_N: Hermansky-Pud 89.7 9.4 0.0002 30.7 13.1 102 225-327 29-166 (215)
444 COG4590 ABC-type uncharacteriz 89.6 0.59 1.3E-05 41.5 4.5 159 143-324 219-386 (733)
445 KOG1520 Predicted alkaloid syn 89.5 14 0.0003 32.5 15.5 81 233-313 197-282 (376)
446 PHA03098 kelch-like protein; P 89.4 12 0.00026 35.2 13.6 66 223-290 437-517 (534)
447 KOG4441 Proteins containing BT 89.3 20 0.00044 34.0 15.5 103 223-327 427-544 (571)
448 PHA02713 hypothetical protein; 89.3 20 0.00044 34.0 16.3 77 236-314 433-520 (557)
449 PF14655 RAB3GAP2_N: Rab3 GTPa 89.0 9.4 0.0002 34.4 11.7 74 213-288 308-402 (415)
450 KOG4460 Nuclear pore complex, 87.7 7.3 0.00016 35.6 10.0 74 214-288 105-202 (741)
451 PLN00033 photosystem II stabil 87.7 21 0.00045 32.2 16.2 101 212-317 280-392 (398)
452 PF12657 TFIIIC_delta: Transcr 87.5 6.2 0.00013 30.8 8.7 30 256-285 87-122 (173)
453 PHA03098 kelch-like protein; P 87.2 27 0.00058 32.9 17.3 90 223-314 389-495 (534)
454 PF14655 RAB3GAP2_N: Rab3 GTPa 87.2 8.3 0.00018 34.7 10.2 30 101-130 309-338 (415)
455 PF12657 TFIIIC_delta: Transcr 87.2 9.7 0.00021 29.7 9.7 31 213-244 86-122 (173)
456 KOG4499 Ca2+-binding protein R 87.1 15 0.00033 30.0 21.9 99 216-314 161-273 (310)
457 TIGR03032 conserved hypothetic 87.0 19 0.00041 31.0 15.4 87 217-307 207-316 (335)
458 PRK13615 lipoprotein LpqB; Pro 86.6 29 0.00063 32.7 20.1 156 101-286 335-504 (557)
459 PF13449 Phytase-like: Esteras 86.4 20 0.00044 31.2 12.3 101 212-314 19-165 (326)
460 KOG4460 Nuclear pore complex, 85.6 7.5 0.00016 35.5 9.0 81 98-179 102-203 (741)
461 PF14781 BBS2_N: Ciliary BBSom 85.5 13 0.00027 27.5 11.7 93 219-313 5-114 (136)
462 cd00216 PQQ_DH Dehydrogenases 85.1 32 0.0007 32.0 20.1 65 111-178 61-132 (488)
463 KOG1916 Nuclear protein, conta 85.0 0.9 1.9E-05 43.9 3.2 113 213-328 133-269 (1283)
464 KOG1900 Nuclear pore complex, 84.8 34 0.00075 35.2 13.8 146 118-285 96-273 (1311)
465 PLN02193 nitrile-specifier pro 84.3 35 0.00075 31.6 17.9 68 223-290 328-416 (470)
466 PF07250 Glyoxal_oxid_N: Glyox 84.1 23 0.0005 29.4 12.2 143 124-292 49-206 (243)
467 KOG1897 Damage-specific DNA bi 83.8 50 0.0011 33.1 22.2 220 102-326 586-858 (1096)
468 PLN02153 epithiospecifier prot 83.5 30 0.00065 30.3 17.2 54 236-289 218-289 (341)
469 COG5276 Uncharacterized conser 83.2 27 0.0006 29.6 16.8 183 102-316 45-234 (370)
470 PF12768 Rax2: Cortical protei 83.1 20 0.00043 30.5 10.2 77 235-311 16-105 (281)
471 KOG1520 Predicted alkaloid syn 82.1 35 0.00076 30.1 14.7 53 274-326 197-249 (376)
472 PRK13615 lipoprotein LpqB; Pro 82.0 47 0.001 31.4 17.2 153 148-331 337-507 (557)
473 PF08728 CRT10: CRT10; InterP 81.1 10 0.00022 36.5 8.5 76 99-174 163-246 (717)
474 TIGR03074 PQQ_membr_DH membran 80.4 39 0.00084 33.4 12.4 65 224-289 260-349 (764)
475 TIGR03075 PQQ_enz_alc_DH PQQ-d 80.1 9.6 0.00021 35.8 8.1 78 235-312 441-520 (527)
476 PF11715 Nup160: Nucleoporin N 79.2 8.7 0.00019 36.3 7.7 33 256-288 216-252 (547)
477 TIGR03032 conserved hypothetic 78.8 42 0.00091 28.9 15.3 54 259-315 207-260 (335)
478 TIGR02171 Fb_sc_TIGR02171 Fibr 78.7 9.7 0.00021 37.5 7.6 54 274-327 327-386 (912)
479 COG5290 IkappaB kinase complex 78.6 70 0.0015 31.4 13.5 92 217-309 251-350 (1243)
480 COG5167 VID27 Protein involved 78.6 56 0.0012 30.2 12.8 59 224-284 573-632 (776)
481 PF05787 DUF839: Bacterial pro 78.3 36 0.00079 31.9 11.1 21 293-313 499-519 (524)
482 TIGR03548 mutarot_permut cycli 77.5 47 0.001 28.8 16.7 28 222-249 170-200 (323)
483 KOG2006 WD40 repeat protein [G 77.3 16 0.00035 36.3 8.7 73 101-174 150-225 (1023)
484 PF11715 Nup160: Nucleoporin N 76.7 12 0.00025 35.5 7.7 70 109-178 156-252 (547)
485 PF01731 Arylesterase: Arylest 76.2 19 0.00041 24.3 6.5 49 235-285 36-85 (86)
486 KOG3616 Selective LIM binding 75.6 8.6 0.00019 36.8 6.2 68 213-283 15-82 (1636)
487 PLN02153 epithiospecifier prot 74.5 59 0.0013 28.5 16.8 67 223-291 137-232 (341)
488 KOG1897 Damage-specific DNA bi 72.3 1.1E+02 0.0025 30.7 20.2 158 101-283 489-658 (1096)
489 smart00564 PQQ beta-propeller 72.1 9.4 0.0002 19.8 3.6 22 268-289 8-29 (33)
490 PRK13613 lipoprotein LpqB; Pro 72.0 96 0.0021 29.8 18.2 159 146-329 364-542 (599)
491 PF01436 NHL: NHL repeat; Int 71.6 11 0.00025 19.0 4.3 25 257-281 4-28 (28)
492 PRK13614 lipoprotein LpqB; Pro 71.4 96 0.0021 29.5 20.1 193 100-317 343-550 (573)
493 PF10214 Rrn6: RNA polymerase 70.1 1.2E+02 0.0026 30.2 19.4 118 99-244 145-277 (765)
494 KOG3616 Selective LIM binding 65.8 19 0.00041 34.7 6.1 55 254-308 14-68 (1636)
495 TIGR03118 PEPCTERM_chp_1 conse 65.4 90 0.0019 26.9 20.6 201 101-325 24-278 (336)
496 PLN02193 nitrile-specifier pro 65.1 1.2E+02 0.0026 28.2 17.4 67 223-291 278-358 (470)
497 TIGR03074 PQQ_membr_DH membran 64.6 34 0.00075 33.8 8.0 80 235-314 641-744 (764)
498 PF07250 Glyoxal_oxid_N: Glyox 64.5 25 0.00055 29.1 6.1 81 236-316 47-138 (243)
499 KOG1983 Tomosyn and related SN 64.0 68 0.0015 32.9 10.1 28 101-128 37-64 (993)
500 PF03022 MRJP: Major royal jel 63.5 95 0.0021 26.6 21.2 200 102-313 3-253 (287)
No 1
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=100.00 E-value=1.9e-35 Score=240.84 Aligned_cols=242 Identities=19% Similarity=0.320 Sum_probs=188.6
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
++.+|-|++|+|+|..||+|+.|.++++||+++.+. .... ++|...|.+++|+|||+.|++++.||+|++||...++
T Consensus 114 H~e~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp--~~t~-KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~ 190 (480)
T KOG0271|consen 114 HGEAVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETP--LFTC-KGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQ 190 (480)
T ss_pred CCCcEEEEEecCCCceEEecCCCceEEeeccCCCCc--ceee-cCCccEEEEEEECCCcchhhccccCCeEEEecCCCCC
Confidence 356899999999999999999999999999976433 2333 6899999999999999999999999999999988776
Q ss_pred CCceeecccccccceecC---------------CCCCceEEee--------eccCCCCCceeeEEECCCCCeEEEEEeCC
Q 018806 178 NAASVRSGAASFLGALSR---------------GPGTRWTLVD--------FLRSQNGEQITALSWGPDGRYLASASYES 234 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~---------------~~~~~~~~~~--------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~ 234 (350)
.......++...+..+++ +.|+..++|+ .+.+|. ..|+++.|--+| +|++++.|
T Consensus 191 ~~g~~l~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~lsgHT-~~VTCvrwGG~g-liySgS~D- 267 (480)
T KOG0271|consen 191 QIGRALRGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTLSGHT-ASVTCVRWGGEG-LIYSGSQD- 267 (480)
T ss_pred cccccccCcccceeEEeecccccCCCccceecccCCCCEEEEEccCceEEEEeccCc-cceEEEEEcCCc-eEEecCCC-
Confidence 655555554444444332 3355555443 567887 689999996544 78888888
Q ss_pred CeEEEEeCCCC---------------------------------------------------------------------
Q 018806 235 SSFTIWDVAQG--------------------------------------------------------------------- 245 (350)
Q Consensus 235 g~i~iwd~~~~--------------------------------------------------------------------- 245 (350)
++|++|+...|
T Consensus 268 rtIkvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsDd~t 347 (480)
T KOG0271|consen 268 RTIKVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSDDFT 347 (480)
T ss_pred ceEEEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecCCce
Confidence 59999987664
Q ss_pred ----------Cc-eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEE
Q 018806 246 ----------LG-TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 246 ----------~~-~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
++ ..+.+|..-|..+.||||+++||+++.|+.|++||.++|+.. .+.+|-..|+.++|+.|.++|+++
T Consensus 348 lflW~p~~~kkpi~rmtgHq~lVn~V~fSPd~r~IASaSFDkSVkLW~g~tGk~lasfRGHv~~VYqvawsaDsRLlVS~ 427 (480)
T KOG0271|consen 348 LFLWNPFKSKKPITRMTGHQALVNHVSFSPDGRYIASASFDKSVKLWDGRTGKFLASFRGHVAAVYQVAWSADSRLLVSG 427 (480)
T ss_pred EEEecccccccchhhhhchhhheeeEEECCCccEEEEeecccceeeeeCCCcchhhhhhhccceeEEEEeccCccEEEEc
Confidence 00 123456667899999999999999999999999999999984 577899999999999999999977
Q ss_pred E-CCCeEEEEEEeCCCCCCCceeecccccceee
Q 018806 314 F-AGSLTLGSIHFASKPPSLDAHLLPVDLPDIV 345 (350)
Q Consensus 314 ~-~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~ 345 (350)
+ |....+|+++.......+.+|...|-.-.+.
T Consensus 428 SkDsTLKvw~V~tkKl~~DLpGh~DEVf~vDws 460 (480)
T KOG0271|consen 428 SKDSTLKVWDVRTKKLKQDLPGHADEVFAVDWS 460 (480)
T ss_pred CCCceEEEEEeeeeeecccCCCCCceEEEEEec
Confidence 6 5445566665555566888898877655444
No 2
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=100.00 E-value=1.1e-35 Score=242.09 Aligned_cols=244 Identities=19% Similarity=0.314 Sum_probs=191.4
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCcc------------------------CeeEEEEecCCCEEEEEECCCeEEEEEcc
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEV------------------------DLQGVSWHQHKHIVAFISGSTQVIVRDYE 129 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~------------------------~V~~v~~sp~g~~la~~s~d~~i~iw~~~ 129 (350)
...+.||...+++..+.|+...++.+. .|.|++|+|||+.||+|+.||+|++||..
T Consensus 108 ssS~~GH~e~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpk 187 (480)
T KOG0271|consen 108 SSSIAGHGEAVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPK 187 (480)
T ss_pred ccccCCCCCcEEEEEecCCCceEEecCCCceEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccCCeEEEecCC
Confidence 467789999999999999777776643 59999999999999999999999999985
Q ss_pred CCCCCceeEecCCCCCCeeEEEEee-----CCCeEEEEecCCcEEEEecCCCCCCceeecccccccceec----------
Q 018806 130 DSEGKDACILTSDSQRDVKVLEWRP-----NGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALS---------- 194 (350)
Q Consensus 130 ~~~~~~~~~~~~~~~~~v~~~~~sp-----~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~---------- 194 (350)
++++......+|...|++++|.| ..+++++++.||.++|||+..+.....+ .++..++..+.
T Consensus 188 --tg~~~g~~l~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~~~l-sgHT~~VTCvrwGG~gliySg 264 (480)
T KOG0271|consen 188 --TGQQIGRALRGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCVRTL-SGHTASVTCVRWGGEGLIYSG 264 (480)
T ss_pred --CCCcccccccCcccceeEEeecccccCCCccceecccCCCCEEEEEccCceEEEEe-ccCccceEEEEEcCCceEEec
Confidence 46666666679999999999965 4567777788999999999732221111 11111111111
Q ss_pred -----------------------------------------------------------------------------CCC
Q 018806 195 -----------------------------------------------------------------------------RGP 197 (350)
Q Consensus 195 -----------------------------------------------------------------------------~~~ 197 (350)
.+.
T Consensus 265 S~DrtIkvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsD 344 (480)
T KOG0271|consen 265 SQDRTIKVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSD 344 (480)
T ss_pred CCCceEEEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecC
Confidence 111
Q ss_pred CCceEEee---------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCC
Q 018806 198 GTRWTLVD---------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGD 267 (350)
Q Consensus 198 ~~~~~~~~---------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~ 267 (350)
+..+.+|+ .+.+|. ..|..+.||||++++|+++.|+ .|++||.++|+... +.+|-..|+.++|+.|.+
T Consensus 345 d~tlflW~p~~~kkpi~rmtgHq-~lVn~V~fSPd~r~IASaSFDk-SVkLW~g~tGk~lasfRGHv~~VYqvawsaDsR 422 (480)
T KOG0271|consen 345 DFTLFLWNPFKSKKPITRMTGHQ-ALVNHVSFSPDGRYIASASFDK-SVKLWDGRTGKFLASFRGHVAAVYQVAWSADSR 422 (480)
T ss_pred CceEEEecccccccchhhhhchh-hheeeEEECCCccEEEEeeccc-ceeeeeCCCcchhhhhhhccceeEEEEeccCcc
Confidence 11222333 344564 6899999999999999999996 99999999998765 556899999999999999
Q ss_pred EEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 268 YFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 268 ~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
+|++|+.|.++++|++++.+. ..+.+|...|..+.|+|||+.++.++ ....+++|
T Consensus 423 LlVS~SkDsTLKvw~V~tkKl~~DLpGh~DEVf~vDwspDG~rV~sgg----kdkv~~lw 478 (480)
T KOG0271|consen 423 LLVSGSKDSTLKVWDVRTKKLKQDLPGHADEVFAVDWSPDGQRVASGG----KDKVLRLW 478 (480)
T ss_pred EEEEcCCCceEEEEEeeeeeecccCCCCCceEEEEEecCCCceeecCC----CceEEEee
Confidence 999999999999999999998 56889999999999999999999774 44455554
No 3
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=100.00 E-value=1.2e-33 Score=233.05 Aligned_cols=220 Identities=16% Similarity=0.222 Sum_probs=190.7
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC--CCeEEEEecCCcEEEEecCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN--GGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
.+|..+.||+|++.||+|+.+|.++||.... ....+.+ .+|...|.++.|+|. +..+++++.||++++|++....
T Consensus 176 rPis~~~fS~ds~~laT~swsG~~kvW~~~~--~~~~~~l-~gH~~~v~~~~fhP~~~~~~lat~s~Dgtvklw~~~~e~ 252 (459)
T KOG0272|consen 176 RPISGCSFSRDSKHLATGSWSGLVKVWSVPQ--CNLLQTL-RGHTSRVGAAVFHPVDSDLNLATASADGTVKLWKLSQET 252 (459)
T ss_pred CcceeeEeecCCCeEEEeecCCceeEeecCC--cceeEEE-eccccceeeEEEccCCCccceeeeccCCceeeeccCCCc
Confidence 4899999999999999999999999999954 5544544 699999999999998 4588899999999999998443
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCC
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGG 256 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~ 256 (350)
. +..+.+|. ..|..++|+|+|++|++++.|. +-++||+.++.... ..+|..+
T Consensus 253 ~-------------------------l~~l~gH~-~RVs~VafHPsG~~L~TasfD~-tWRlWD~~tk~ElL~QEGHs~~ 305 (459)
T KOG0272|consen 253 P-------------------------LQDLEGHL-ARVSRVAFHPSGKFLGTASFDS-TWRLWDLETKSELLLQEGHSKG 305 (459)
T ss_pred c-------------------------hhhhhcch-hhheeeeecCCCceeeeccccc-chhhcccccchhhHhhcccccc
Confidence 2 44477886 7999999999999999999996 99999999987654 4568899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCce
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDA 334 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~ 334 (350)
|.+++|++||..+++|+.|..-+|||++++.+ ..+.+|..+|.+++|+|+|..|++|+ |+...||+++..+....+.+
T Consensus 306 v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~gH~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r~~ly~ipA 385 (459)
T KOG0272|consen 306 VFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLAGHIKEILSVAFSPNGYHLATGSSDNTCKVWDLRMRSELYTIPA 385 (459)
T ss_pred cceeEecCCCceeeccCccchhheeecccCcEEEEecccccceeeEeECCCceEEeecCCCCcEEEeeecccccceeccc
Confidence 99999999999999999999999999999998 56779999999999999999999987 77788888888777778889
Q ss_pred eecccccceeecccC
Q 018806 335 HLLPVDLPDIVSLTG 349 (350)
Q Consensus 335 ~~~~v~~~~~~~~~g 349 (350)
|..-|..-.+.+..|
T Consensus 386 H~nlVS~Vk~~p~~g 400 (459)
T KOG0272|consen 386 HSNLVSQVKYSPQEG 400 (459)
T ss_pred ccchhhheEecccCC
Confidence 998887666655333
No 4
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=100.00 E-value=2.4e-34 Score=237.00 Aligned_cols=215 Identities=17% Similarity=0.229 Sum_probs=183.2
Q ss_pred CeeEEEEecC--CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQH--KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~--g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
.|.++.|+|. +..||+|+.||++++|+++. ...+..+ .+|...|..++|+|+|+.|.+++.|.+-++||+.++..
T Consensus 219 ~v~~~~fhP~~~~~~lat~s~Dgtvklw~~~~--e~~l~~l-~gH~~RVs~VafHPsG~~L~TasfD~tWRlWD~~tk~E 295 (459)
T KOG0272|consen 219 RVGAAVFHPVDSDLNLATASADGTVKLWKLSQ--ETPLQDL-EGHLARVSRVAFHPSGKFLGTASFDSTWRLWDLETKSE 295 (459)
T ss_pred ceeeEEEccCCCccceeeeccCCceeeeccCC--Ccchhhh-hcchhhheeeeecCCCceeeecccccchhhcccccchh
Confidence 4889999997 57899999999999999964 3444444 58999999999999999999999999999999995543
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
.. ...||. ..|.+++|.|||..+++|+.|+ .-+|||++++.++. +.+|..+|
T Consensus 296 lL-------------------------~QEGHs-~~v~~iaf~~DGSL~~tGGlD~-~~RvWDlRtgr~im~L~gH~k~I 348 (459)
T KOG0272|consen 296 LL-------------------------LQEGHS-KGVFSIAFQPDGSLAATGGLDS-LGRVWDLRTGRCIMFLAGHIKEI 348 (459)
T ss_pred hH-------------------------hhcccc-cccceeEecCCCceeeccCccc-hhheeecccCcEEEEecccccce
Confidence 22 246776 7999999999999999999996 99999999998865 55688999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcC-CCCEEEEEE-CCCeEEEEEEeCCCCCCCce
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDP-EGRMILLAF-AGSLTLGSIHFASKPPSLDA 334 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~-~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~ 334 (350)
.+++|+|+|..||+|+.|++++|||++..+. ..+..|..-|+.+.|+| .|.+|++++ |+...+|.-+-|....++.+
T Consensus 349 ~~V~fsPNGy~lATgs~Dnt~kVWDLR~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~TasyD~t~kiWs~~~~~~~ksLaG 428 (459)
T KOG0272|consen 349 LSVAFSPNGYHLATGSSDNTCKVWDLRMRSELYTIPAHSNLVSQVKYSPQEGYFLVTASYDNTVKIWSTRTWSPLKSLAG 428 (459)
T ss_pred eeEeECCCceEEeecCCCCcEEEeeecccccceecccccchhhheEecccCCeEEEEcccCcceeeecCCCcccchhhcC
Confidence 9999999999999999999999999998776 46779999999999999 788888886 66666666667777778999
Q ss_pred eecccccceee
Q 018806 335 HLLPVDLPDIV 345 (350)
Q Consensus 335 ~~~~v~~~~~~ 345 (350)
|...|-...+.
T Consensus 429 He~kV~s~Dis 439 (459)
T KOG0272|consen 429 HEGKVISLDIS 439 (459)
T ss_pred CccceEEEEec
Confidence 99888766554
No 5
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=100.00 E-value=4.8e-32 Score=219.69 Aligned_cols=330 Identities=40% Similarity=0.701 Sum_probs=261.5
Q ss_pred CCCCCCCCceeEEEEeceEeeccCCcchhhhhhhccccceeecccCCCcc-cccCCCCchhhhhhccccccccchhhhhh
Q 018806 1 MPSFPRPGSVTVCEINRDLITADNLSDDRAKDTYGKVLGMVFAPVPFQSD-ELASSSPDRQESEQRGREEGEGLFSTLHG 79 (350)
Q Consensus 1 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~g 79 (350)
|-|+|+|+....|++|+|+++.-+.+|.+...+|+|+.+|+|.|+-|... ..+..++. +..+. ...+.+.+.+++.-
T Consensus 1 ~~s~P~~~r~pv~~ln~dll~~p~~~d~~~~E~v~Kr~~~vf~~vgf~~tl~e~~~~E~-E~~~~-~~~as~~~~a~l~~ 78 (445)
T KOG2139|consen 1 MASFPHPGRVPVCELNRDLLTAPNLSDERAQETVGKRLGMVFSPVGFDSTLSELQENEG-ENGDK-ASGASKGLVATLQM 78 (445)
T ss_pred CCCCCCCCccceEEecchhhcCCccchhhHHHHHHhhhheeecccccccchHHhhCccc-ccchh-hcccchHHHHHHHH
Confidence 78999999999999999999999999999999999999999999987665 22222222 22222 22345667777766
Q ss_pred hhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeE
Q 018806 80 IISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRS 159 (350)
Q Consensus 80 h~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l 159 (350)
..+.....+..+.+..+..+.++..++|++.-..+|++..|-.|++|+-. ......+.......|++++|-|.+..-
T Consensus 79 a~~l~~~~Iaqf~~vt~ws~~dlr~~aWhqH~~~fava~nddvVriy~ks---st~pt~Lks~sQrnvtclawRPlsase 155 (445)
T KOG2139|consen 79 AVALSLKQIAQFTDVTLWSEIDLRGVAWHQHIIAFAVATNDDVVRIYDKS---STCPTKLKSVSQRNVTCLAWRPLSASE 155 (445)
T ss_pred hhhhhHHHhhchhhhhhhhhcceeeEeechhhhhhhhhccCcEEEEeccC---CCCCceecchhhcceeEEEeccCCcce
Confidence 66655667777788888889999999999987788889999999999964 355566655667889999999999899
Q ss_pred EEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeee--ccCCCCCceeeEEECCCCCeEEEEEeCCCeE
Q 018806 160 LSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDF--LRSQNGEQITALSWGPDGRYLASASYESSSF 237 (350)
Q Consensus 160 ~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i 237 (350)
++.+..+.|++|......+......+... ...+. ..+| ..|++++|.+||..+++++.++..|
T Consensus 156 lavgCr~gIciW~~s~tln~~r~~~~~s~-------------~~~qvl~~pgh--~pVtsmqwn~dgt~l~tAS~gsssi 220 (445)
T KOG2139|consen 156 LAVGCRAGICIWSDSRTLNANRNIRMMST-------------HHLQVLQDPGH--NPVTSMQWNEDGTILVTASFGSSSI 220 (445)
T ss_pred eeeeecceeEEEEcCcccccccccccccc-------------cchhheeCCCC--ceeeEEEEcCCCCEEeecccCcceE
Confidence 99999999999998754433222111000 00111 2344 5899999999999999998877799
Q ss_pred EEEeCCCCCceeee-ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC-CCCceeccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 238 TIWDVAQGLGTPIR-RGFGGLSILKWSPTGDYFFAAKFDGTFYLWET-NTWTSEPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 238 ~iwd~~~~~~~~~~-~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~-~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
.|||..++...++. ...+++.-+.|||||.+|+++.-|+..++|+. ++....++.-..+.|....|+|+|++|++++.
T Consensus 221 ~iWdpdtg~~~pL~~~glgg~slLkwSPdgd~lfaAt~davfrlw~e~q~wt~erw~lgsgrvqtacWspcGsfLLf~~s 300 (445)
T KOG2139|consen 221 MIWDPDTGQKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAVFRLWQENQSWTKERWILGSGRVQTACWSPCGSFLLFACS 300 (445)
T ss_pred EEEcCCCCCcccccccCCCceeeEEEcCCCCEEEEecccceeeeehhcccceecceeccCCceeeeeecCCCCEEEEEEc
Confidence 99999999988877 45688999999999999999999999999954 44455666666679999999999999999999
Q ss_pred CCeEEEEEEeCCCCCCCc------eeecccccceeecccCC
Q 018806 316 GSLTLGSIHFASKPPSLD------AHLLPVDLPDIVSLTGR 350 (350)
Q Consensus 316 ~~~~~~~~~~~~~~~~~~------~~~~~v~~~~~~~~~g~ 350 (350)
+...+|.+.+.++...+. .|..+++++++...+|+
T Consensus 301 gsp~lysl~f~~~~~~~~~~~~~k~~lliaDL~e~ti~ag~ 341 (445)
T KOG2139|consen 301 GSPRLYSLTFDGEDSVFLRPQSIKRVLLIADLQEVTICAGQ 341 (445)
T ss_pred CCceEEEEeecCCCccccCcccceeeeeeccchhhhhhcCc
Confidence 999999999998766444 88888888888877763
No 6
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=100.00 E-value=3.2e-32 Score=240.71 Aligned_cols=196 Identities=16% Similarity=0.296 Sum_probs=170.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
.+|..++|+|+.++|+++|.|+++++|.+.+ ..+.... .+|..+|+.+.|+|.|-++++++.|++.++|......
T Consensus 452 GPVyg~sFsPd~rfLlScSED~svRLWsl~t--~s~~V~y-~GH~~PVwdV~F~P~GyYFatas~D~tArLWs~d~~~-- 526 (707)
T KOG0263|consen 452 GPVYGCSFSPDRRFLLSCSEDSSVRLWSLDT--WSCLVIY-KGHLAPVWDVQFAPRGYYFATASHDQTARLWSTDHNK-- 526 (707)
T ss_pred CceeeeeecccccceeeccCCcceeeeeccc--ceeEEEe-cCCCcceeeEEecCCceEEEecCCCceeeeeecccCC--
Confidence 3599999999999999999999999999965 4554544 5999999999999998888888889999999988321
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~~~~v~ 258 (350)
..+.+.+|. +.|.|+.|+|+..++++++.|. +|++||+.+|...+++ +|.++|.
T Consensus 527 -----------------------PlRifaghl-sDV~cv~FHPNs~Y~aTGSsD~-tVRlWDv~~G~~VRiF~GH~~~V~ 581 (707)
T KOG0263|consen 527 -----------------------PLRIFAGHL-SDVDCVSFHPNSNYVATGSSDR-TVRLWDVSTGNSVRIFTGHKGPVT 581 (707)
T ss_pred -----------------------chhhhcccc-cccceEEECCcccccccCCCCc-eEEEEEcCCCcEEEEecCCCCceE
Confidence 244567776 7999999999999999999995 9999999999887755 6889999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
+++|||+|++|++|+.|+.|++||+.+++. .++.+|.+.|.++.||.||..|++++ +.++.+|++..
T Consensus 582 al~~Sp~Gr~LaSg~ed~~I~iWDl~~~~~v~~l~~Ht~ti~SlsFS~dg~vLasgg~DnsV~lWD~~~ 650 (707)
T KOG0263|consen 582 ALAFSPCGRYLASGDEDGLIKIWDLANGSLVKQLKGHTGTIYSLSFSRDGNVLASGGADNSVRLWDLTK 650 (707)
T ss_pred EEEEcCCCceEeecccCCcEEEEEcCCCcchhhhhcccCceeEEEEecCCCEEEecCCCCeEEEEEchh
Confidence 999999999999999999999999999887 67889999999999999999999887 55555555443
No 7
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=100.00 E-value=3.4e-31 Score=207.74 Aligned_cols=196 Identities=15% Similarity=0.209 Sum_probs=166.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|..+..++||++.++++.|+++++||+.. ++....+ .+|...|.+++|++|.+++++++.|++|++|++. +....
T Consensus 65 ~v~dv~~s~dg~~alS~swD~~lrlWDl~~--g~~t~~f-~GH~~dVlsva~s~dn~qivSGSrDkTiklwnt~-g~ck~ 140 (315)
T KOG0279|consen 65 FVSDVVLSSDGNFALSASWDGTLRLWDLAT--GESTRRF-VGHTKDVLSVAFSTDNRQIVSGSRDKTIKLWNTL-GVCKY 140 (315)
T ss_pred EecceEEccCCceEEeccccceEEEEEecC--CcEEEEE-EecCCceEEEEecCCCceeecCCCcceeeeeeec-ccEEE
Confidence 589999999999999999999999999964 5554544 6999999999999999999999999999999987 22211
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCC-CCceeeEEECCC--CCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQN-GEQITALSWGPD--GRYLASASYESSSFTIWDVAQGLGTP-IRRGFGG 256 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~v~~~~~sp~--g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~ 256 (350)
. +..+. ...|.++.|+|+ ...|++++.| ++|++||+++.+... ..+|.+.
T Consensus 141 t-------------------------~~~~~~~~WVscvrfsP~~~~p~Ivs~s~D-ktvKvWnl~~~~l~~~~~gh~~~ 194 (315)
T KOG0279|consen 141 T-------------------------IHEDSHREWVSCVRFSPNESNPIIVSASWD-KTVKVWNLRNCQLRTTFIGHSGY 194 (315)
T ss_pred E-------------------------EecCCCcCcEEEEEEcCCCCCcEEEEccCC-ceEEEEccCCcchhhcccccccc
Confidence 1 11111 369999999998 6789999999 599999999988765 5568899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
++.+++||||...++|+.||.+.+||++.++......+...|.+++|+|+.-+|+.+.+.++.||+..-.
T Consensus 195 v~t~~vSpDGslcasGgkdg~~~LwdL~~~k~lysl~a~~~v~sl~fspnrywL~~at~~sIkIwdl~~~ 264 (315)
T KOG0279|consen 195 VNTVTVSPDGSLCASGGKDGEAMLWDLNEGKNLYSLEAFDIVNSLCFSPNRYWLCAATATSIKIWDLESK 264 (315)
T ss_pred EEEEEECCCCCEEecCCCCceEEEEEccCCceeEeccCCCeEeeEEecCCceeEeeccCCceEEEeccch
Confidence 9999999999999999999999999999999988889999999999999998888887766666655443
No 8
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.98 E-value=1.2e-30 Score=205.97 Aligned_cols=243 Identities=14% Similarity=0.186 Sum_probs=199.3
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCcc------------------------CeeEEEEecCCCEEEEEECCCeEEEEEcc
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEV------------------------DLQGVSWHQHKHIVAFISGSTQVIVRDYE 129 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~------------------------~V~~v~~sp~g~~la~~s~d~~i~iw~~~ 129 (350)
..+|+||.+.++...+.++...++... .|..++|+|.|+++|+|+.|+...||++.
T Consensus 48 rr~LkGH~~Ki~~~~ws~Dsr~ivSaSqDGklIvWDs~TtnK~haipl~s~WVMtCA~sPSg~~VAcGGLdN~Csiy~ls 127 (343)
T KOG0286|consen 48 RRTLKGHLNKIYAMDWSTDSRRIVSASQDGKLIVWDSFTTNKVHAIPLPSSWVMTCAYSPSGNFVACGGLDNKCSIYPLS 127 (343)
T ss_pred EEEecccccceeeeEecCCcCeEEeeccCCeEEEEEcccccceeEEecCceeEEEEEECCCCCeEEecCcCceeEEEecc
Confidence 478999999999988888876666532 58899999999999999999999999997
Q ss_pred CCCCC---ceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeee
Q 018806 130 DSEGK---DACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDF 206 (350)
Q Consensus 130 ~~~~~---~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 206 (350)
..+.. .+.....+|.+.+.++.|-+| .+|++++.|.+..+||++.+.. ...
T Consensus 128 ~~d~~g~~~v~r~l~gHtgylScC~f~dD-~~ilT~SGD~TCalWDie~g~~-------------------------~~~ 181 (343)
T KOG0286|consen 128 TRDAEGNVRVSRELAGHTGYLSCCRFLDD-NHILTGSGDMTCALWDIETGQQ-------------------------TQV 181 (343)
T ss_pred cccccccceeeeeecCccceeEEEEEcCC-CceEecCCCceEEEEEcccceE-------------------------EEE
Confidence 54222 333344689999999999987 8999999999999999995543 455
Q ss_pred ccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCC
Q 018806 207 LRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 207 ~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~ 284 (350)
+.+|. +.|.+++++| +++.+++++-| +..++||++.+.+.+ +.+|...|.+++|.|+|.-+++|++|++.++||++
T Consensus 182 f~GH~-gDV~slsl~p~~~ntFvSg~cD-~~aklWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~tcRlyDlR 259 (343)
T KOG0286|consen 182 FHGHT-GDVMSLSLSPSDGNTFVSGGCD-KSAKLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDATCRLYDLR 259 (343)
T ss_pred ecCCc-ccEEEEecCCCCCCeEEecccc-cceeeeeccCcceeEeecccccccceEEEccCCCeeeecCCCceeEEEeec
Confidence 77887 7999999999 99999999999 599999999998766 55688999999999999999999999999999999
Q ss_pred CCceeccccC---CCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC--CCCCCCceeecccccceee
Q 018806 285 TWTSEPWSST---SGFVTGATWDPEGRMILLAFAGSLTLGSIHFA--SKPPSLDAHLLPVDLPDIV 345 (350)
Q Consensus 285 ~~~~~~~~~~---~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~--~~~~~~~~~~~~v~~~~~~ 345 (350)
.........+ ..+|++++||..|++|++|. .+.....|+.- .....+.+|...|....+.
T Consensus 260 aD~~~a~ys~~~~~~gitSv~FS~SGRlLfagy-~d~~c~vWDtlk~e~vg~L~GHeNRvScl~~s 324 (343)
T KOG0286|consen 260 ADQELAVYSHDSIICGITSVAFSKSGRLLFAGY-DDFTCNVWDTLKGERVGVLAGHENRVSCLGVS 324 (343)
T ss_pred CCcEEeeeccCcccCCceeEEEcccccEEEeee-cCCceeEeeccccceEEEeeccCCeeEEEEEC
Confidence 9877655444 45789999999999999874 22344444443 3334788999998776554
No 9
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.98 E-value=1.6e-30 Score=217.24 Aligned_cols=219 Identities=21% Similarity=0.374 Sum_probs=173.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|++++|+.+|..||+|+.||.++||+.. +.....+ ..|.++|.+++|+..|.++++++.|+++.+||...+...+
T Consensus 237 dVT~L~Wn~~G~~LatG~~~G~~riw~~~---G~l~~tl-~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q 312 (524)
T KOG0273|consen 237 DVTSLDWNNDGTLLATGSEDGEARIWNKD---GNLISTL-GQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQ 312 (524)
T ss_pred CcceEEecCCCCeEEEeecCcEEEEEecC---chhhhhh-hccCCceEEEEEcCCCCEEEeccCCccEEEEeccCceEEE
Confidence 69999999999999999999999999975 5555555 5799999999999999999999999999999997554443
Q ss_pred eeeccccc-------ccceecC-CCCCceE--------EeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC
Q 018806 181 SVRSGAAS-------FLGALSR-GPGTRWT--------LVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 181 ~~~~~~~~-------~~~~~~~-~~~~~~~--------~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~ 244 (350)
.+...... ....|+. +.++.+. ...++.+|+ +.|.++.|+|.|..|++++.| ++++||+...
T Consensus 313 ~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~-g~V~alk~n~tg~LLaS~SdD-~TlkiWs~~~ 390 (524)
T KOG0273|consen 313 QFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHH-GEVNALKWNPTGSLLASCSDD-GTLKIWSMGQ 390 (524)
T ss_pred eeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceeeeccc-CceEEEEECCCCceEEEecCC-CeeEeeecCC
Confidence 33222111 1111222 2333333 234678887 799999999999999999999 7999999776
Q ss_pred CCc-eeeeecCCCeEEEEEcCCC---------CEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEE
Q 018806 245 GLG-TPIRRGFGGLSILKWSPTG---------DYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 245 ~~~-~~~~~~~~~v~~~~~sp~g---------~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
... ..+..|...|+.+.|+|+| ..+++++.|++|++||+..+.+ ..+..|..+|++++|+|+|+++++|
T Consensus 391 ~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~dstV~lwdv~~gv~i~~f~kH~~pVysvafS~~g~ylAsG 470 (524)
T KOG0273|consen 391 SNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASASFDSTVKLWDVESGVPIHTLMKHQEPVYSVAFSPNGRYLASG 470 (524)
T ss_pred CcchhhhhhhccceeeEeecCCCCccCCCcCCceEEEeecCCeEEEEEccCCceeEeeccCCCceEEEEecCCCcEEEec
Confidence 554 4577888999999999965 4689999999999999999988 4677999999999999999999999
Q ss_pred ECCCeEEEEEEeCCCC
Q 018806 314 FAGSLTLGSIHFASKP 329 (350)
Q Consensus 314 ~~~~~~~~~~~~~~~~ 329 (350)
+ ..+.+++|..+
T Consensus 471 s----~dg~V~iws~~ 482 (524)
T KOG0273|consen 471 S----LDGCVHIWSTK 482 (524)
T ss_pred C----CCCeeEecccc
Confidence 5 34444455443
No 10
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.97 E-value=1.3e-29 Score=195.75 Aligned_cols=214 Identities=15% Similarity=0.194 Sum_probs=169.1
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
+...|+++.|..+|+++++|+.||+++|||+.. ...... ..|..+|+++..+|+-..|+++..+|.|++||+....
T Consensus 82 h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~--~~~qR~--~~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~ 157 (311)
T KOG0315|consen 82 HTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRS--LSCQRN--YQHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENS 157 (311)
T ss_pred cCCceEEEEEeecCeEEEecCCCceEEEEeccC--cccchh--ccCCCCcceEEecCCcceEEeecCCCcEEEEEccCCc
Confidence 345799999999999999999999999999964 222222 3678999999999997788888889999999998654
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-------eee
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-------TPI 250 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-------~~~ 250 (350)
....+... ....|.++...|||.+++.+... |++++|++-.... .++
T Consensus 158 c~~~liPe-------------------------~~~~i~sl~v~~dgsml~a~nnk-G~cyvW~l~~~~~~s~l~P~~k~ 211 (311)
T KOG0315|consen 158 CTHELIPE-------------------------DDTSIQSLTVMPDGSMLAAANNK-GNCYVWRLLNHQTASELEPVHKF 211 (311)
T ss_pred cccccCCC-------------------------CCcceeeEEEcCCCcEEEEecCC-ccEEEEEccCCCccccceEhhhe
Confidence 44332221 23689999999999999998888 8999999987532 235
Q ss_pred eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCC-ce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCC
Q 018806 251 RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTW-TS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFAS 327 (350)
Q Consensus 251 ~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~-~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~ 327 (350)
..|.+.+..+.+|||+++||+++.|.+++||+.++. +. ..+.+|..+++.++||.||+||++++ +...++|.+....
T Consensus 212 ~ah~~~il~C~lSPd~k~lat~ssdktv~iwn~~~~~kle~~l~gh~rWvWdc~FS~dg~YlvTassd~~~rlW~~~~~k 291 (311)
T KOG0315|consen 212 QAHNGHILRCLLSPDVKYLATCSSDKTVKIWNTDDFFKLELVLTGHQRWVWDCAFSADGEYLVTASSDHTARLWDLSAGK 291 (311)
T ss_pred ecccceEEEEEECCCCcEEEeecCCceEEEEecCCceeeEEEeecCCceEEeeeeccCccEEEecCCCCceeecccccCc
Confidence 568899999999999999999999999999999987 33 56778999999999999999999987 3333444333333
Q ss_pred CCCCCceeeccccc
Q 018806 328 KPPSLDAHLLPVDL 341 (350)
Q Consensus 328 ~~~~~~~~~~~v~~ 341 (350)
......+|..+...
T Consensus 292 ~v~qy~gh~K~~vc 305 (311)
T KOG0315|consen 292 EVRQYQGHHKAAVC 305 (311)
T ss_pred eeeecCCcccccEE
Confidence 33566777665443
No 11
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.97 E-value=3.2e-29 Score=196.68 Aligned_cols=194 Identities=14% Similarity=0.270 Sum_probs=158.7
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCC-CCCCeeEEEEeeC--CCeEEEEecCCcEEEEecCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSD-SQRDVKVLEWRPN--GGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~-~~~~v~~~~~sp~--~~~l~~~~~d~~v~iwd~~~~ 176 (350)
..|.+++|++|.+.|++|+.|++|++|+.- +.+...+... +.+.|.+++|+|+ ...++.++.|++|++||++..
T Consensus 106 ~dVlsva~s~dn~qivSGSrDkTiklwnt~---g~ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~ 182 (315)
T KOG0279|consen 106 KDVLSVAFSTDNRQIVSGSRDKTIKLWNTL---GVCKYTIHEDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNC 182 (315)
T ss_pred CceEEEEecCCCceeecCCCcceeeeeeec---ccEEEEEecCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCc
Confidence 379999999999999999999999999985 4544555433 3789999999998 456777888999999999833
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGG 256 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~ 256 (350)
+ +...+.+|. +.++.+++||||..+++++.| |.+.+||++.++......+...
T Consensus 183 ~-------------------------l~~~~~gh~-~~v~t~~vSpDGslcasGgkd-g~~~LwdL~~~k~lysl~a~~~ 235 (315)
T KOG0279|consen 183 Q-------------------------LRTTFIGHS-GYVNTVTVSPDGSLCASGGKD-GEAMLWDLNEGKNLYSLEAFDI 235 (315)
T ss_pred c-------------------------hhhcccccc-ccEEEEEECCCCCEEecCCCC-ceEEEEEccCCceeEeccCCCe
Confidence 2 234467776 799999999999999999999 7999999999999888899999
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-c----cc-----CCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-W----SS-----TSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~----~~-----~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
|.+++|+|+.-+|+.+. +..|+|||++++.+.. + .+ ......+++|++||+.|+.+. ++.+.+|.+.
T Consensus 236 v~sl~fspnrywL~~at-~~sIkIwdl~~~~~v~~l~~d~~g~s~~~~~~~clslaws~dG~tLf~g~td~~irv~qv~ 313 (315)
T KOG0279|consen 236 VNSLCFSPNRYWLCAAT-ATSIKIWDLESKAVVEELKLDGIGPSSKAGDPICLSLAWSADGQTLFAGYTDNVIRVWQVA 313 (315)
T ss_pred EeeEEecCCceeEeecc-CCceEEEeccchhhhhhccccccccccccCCcEEEEEEEcCCCcEEEeeecCCcEEEEEee
Confidence 99999999987776654 4559999999987631 1 11 234567899999999999886 6666666654
No 12
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.97 E-value=1.7e-28 Score=191.86 Aligned_cols=197 Identities=19% Similarity=0.370 Sum_probs=164.6
Q ss_pred eeEEEEecC-CCEEEEEECCCeEEEEEccC-CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQH-KHIVAFISGSTQVIVRDYED-SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~-g~~la~~s~d~~i~iw~~~~-~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
|..++|+|- |..||+++.|+.|+||+... .+-.+...+..+|...|++++|+|.|+.|++++.|.++.||.-.
T Consensus 17 ~W~~awhp~~g~ilAscg~Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aSFD~t~~Iw~k~----- 91 (312)
T KOG0645|consen 17 VWSVAWHPGKGVILASCGTDKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASASFDATVVIWKKE----- 91 (312)
T ss_pred EEEEEeccCCceEEEeecCCceEEEEecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEeeccceEEEeecC-----
Confidence 899999998 89999999999999999863 22333444545799999999999999988888889999999765
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce----eeeecCC
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT----PIRRGFG 255 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~----~~~~~~~ 255 (350)
++.+.+..++.||. ..|.+++|+++|.+||+++.|+ .|.||.+...... .+..|..
T Consensus 92 ------------------~~efecv~~lEGHE-nEVK~Vaws~sG~~LATCSRDK-SVWiWe~deddEfec~aVL~~Htq 151 (312)
T KOG0645|consen 92 ------------------DGEFECVATLEGHE-NEVKCVAWSASGNYLATCSRDK-SVWIWEIDEDDEFECIAVLQEHTQ 151 (312)
T ss_pred ------------------CCceeEEeeeeccc-cceeEEEEcCCCCEEEEeeCCC-eEEEEEecCCCcEEEEeeeccccc
Confidence 44667888999997 7999999999999999999996 9999999865432 3557889
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCc----eeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEE
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETNTWT----SEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIH 324 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~----~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~ 324 (350)
.|..+.|+|...+|++++.|++|++|+-..+. ..++.+|...|++++|++.|..|+++++. ..+..|+
T Consensus 152 DVK~V~WHPt~dlL~S~SYDnTIk~~~~~~dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD-~tv~Iw~ 223 (312)
T KOG0645|consen 152 DVKHVIWHPTEDLLFSCSYDNTIKVYRDEDDDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDD-GTVSIWR 223 (312)
T ss_pred cccEEEEcCCcceeEEeccCCeEEEEeecCCCCeeEEEEecCccceEEEEEecCCCceEEEecCC-cceEeee
Confidence 99999999999999999999999999887433 25677899999999999999999877633 3444444
No 13
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.97 E-value=1.4e-28 Score=208.46 Aligned_cols=267 Identities=17% Similarity=0.286 Sum_probs=199.6
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCc-c------------------------CeeEEEEecCCCEEEEEECCCeEEEEEc
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPE-V------------------------DLQGVSWHQHKHIVAFISGSTQVIVRDY 128 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~-~------------------------~V~~v~~sp~g~~la~~s~d~~i~iw~~ 128 (350)
+.-+.||...+....+.|..+.-+.. . -|+|+.|+|||.++|+++.||++.+||=
T Consensus 140 vGei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~HskFV~~VRysPDG~~Fat~gsDgki~iyDG 219 (603)
T KOG0318|consen 140 VGEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHSKFVNCVRYSPDGSRFATAGSDGKIYIYDG 219 (603)
T ss_pred cceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccccceeeEEECCCCCeEEEecCCccEEEEcC
Confidence 46678999888888888876543321 1 4999999999999999999999999997
Q ss_pred cCCCCCceeEec--CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccce----------ecCC
Q 018806 129 EDSEGKDACILT--SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGA----------LSRG 196 (350)
Q Consensus 129 ~~~~~~~~~~~~--~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~----------~~~~ 196 (350)
.++..+..+. .+|.+.|.+++|+||+.++++++.|.+++|||+........+..+.....+. +..+
T Consensus 220 --ktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~~~~~~v~dqqvG~lWqkd~lItVS 297 (603)
T KOG0318|consen 220 --KTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTWPMGSTVEDQQVGCLWQKDHLITVS 297 (603)
T ss_pred --CCccEEEEecCCCCccccEEEEEECCCCceEEEecCCceEEEEEeeccceEEEeecCCchhceEEEEEEeCCeEEEEE
Confidence 4466666664 2699999999999999999999999999999999665555444332211111 1222
Q ss_pred CCCceE--------EeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-----------------------
Q 018806 197 PGTRWT--------LVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG----------------------- 245 (350)
Q Consensus 197 ~~~~~~--------~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~----------------------- 245 (350)
-++.+. ..+.+.+|. ..|++++.+|++++|++++.| |.|.-||..++
T Consensus 298 l~G~in~ln~~d~~~~~~i~GHn-K~ITaLtv~~d~~~i~SgsyD-G~I~~W~~~~g~~~~~~g~~h~nqI~~~~~~~~~ 375 (603)
T KOG0318|consen 298 LSGTINYLNPSDPSVLKVISGHN-KSITALTVSPDGKTIYSGSYD-GHINSWDSGSGTSDRLAGKGHTNQIKGMAASESG 375 (603)
T ss_pred cCcEEEEecccCCChhheecccc-cceeEEEEcCCCCEEEeeccC-ceEEEEecCCccccccccccccceEEEEeecCCC
Confidence 222222 445678886 799999999999999999999 79999987655
Q ss_pred --------------------------------------------------------------------------------
Q 018806 246 -------------------------------------------------------------------------------- 245 (350)
Q Consensus 246 -------------------------------------------------------------------------------- 245 (350)
T Consensus 376 ~~~t~g~Dd~l~~~~~~~~~~t~~~~~~lg~QP~~lav~~d~~~avv~~~~~iv~l~~~~~~~~~~~~y~~s~vAv~~~~ 455 (603)
T KOG0318|consen 376 ELFTIGWDDTLRVISLKDNGYTKSEVVKLGSQPKGLAVLSDGGTAVVACISDIVLLQDQTKVSSIPIGYESSAVAVSPDG 455 (603)
T ss_pred cEEEEecCCeEEEEecccCcccccceeecCCCceeEEEcCCCCEEEEEecCcEEEEecCCcceeeccccccceEEEcCCC
Confidence
Q ss_pred -----------------------CceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEE
Q 018806 246 -----------------------LGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTG 300 (350)
Q Consensus 246 -----------------------~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~ 300 (350)
+......|.+++++++||||+.+||++...+.+-+||+.+.+. ..+.-|...|.+
T Consensus 456 ~~vaVGG~Dgkvhvysl~g~~l~ee~~~~~h~a~iT~vaySpd~~yla~~Da~rkvv~yd~~s~~~~~~~w~FHtakI~~ 535 (603)
T KOG0318|consen 456 SEVAVGGQDGKVHVYSLSGDELKEEAKLLEHRAAITDVAYSPDGAYLAAGDASRKVVLYDVASREVKTNRWAFHTAKINC 535 (603)
T ss_pred CEEEEecccceEEEEEecCCcccceeeeecccCCceEEEECCCCcEEEEeccCCcEEEEEcccCceecceeeeeeeeEEE
Confidence 0112334667889999999999999999999999999998877 345579999999
Q ss_pred EEEcCCCCEEEEEE-CCCeEEEEEEeCCCCC-CCceeeccccccee
Q 018806 301 ATWDPEGRMILLAF-AGSLTLGSIHFASKPP-SLDAHLLPVDLPDI 344 (350)
Q Consensus 301 ~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~-~~~~~~~~v~~~~~ 344 (350)
++|+|+.+++|+|+ |..+.+|.++-..+.. -..+|...|....+
T Consensus 536 ~aWsP~n~~vATGSlDt~Viiysv~kP~~~i~iknAH~~gVn~v~w 581 (603)
T KOG0318|consen 536 VAWSPNNKLVATGSLDTNVIIYSVKKPAKHIIIKNAHLGGVNSVAW 581 (603)
T ss_pred EEeCCCceEEEeccccceEEEEEccChhhheEeccccccCceeEEE
Confidence 99999999999987 5555555555443322 33467666655444
No 14
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.97 E-value=4.8e-30 Score=210.93 Aligned_cols=219 Identities=18% Similarity=0.277 Sum_probs=183.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..|..|.|.|+|+.|++|+..|...+|+... -....+...|+.+|+++.|+++|..++++..+|.|++|+.... .
T Consensus 97 c~V~~v~WtPeGRRLltgs~SGEFtLWNg~~---fnFEtilQaHDs~Vr~m~ws~~g~wmiSgD~gG~iKyWqpnmn-n- 171 (464)
T KOG0284|consen 97 CPVNVVRWTPEGRRLLTGSQSGEFTLWNGTS---FNFETILQAHDSPVRTMKWSHNGTWMISGDKGGMIKYWQPNMN-N- 171 (464)
T ss_pred cceeeEEEcCCCceeEeecccccEEEecCce---eeHHHHhhhhcccceeEEEccCCCEEEEcCCCceEEecccchh-h-
Confidence 3799999999999999999999999999632 2223344579999999999999999998888999999998722 1
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~ 258 (350)
+..+..|+...|++++|+|+...+++++.| |+|+|||....+... +.+|.-.|.
T Consensus 172 ------------------------Vk~~~ahh~eaIRdlafSpnDskF~t~SdD-g~ikiWdf~~~kee~vL~GHgwdVk 226 (464)
T KOG0284|consen 172 ------------------------VKIIQAHHAEAIRDLAFSPNDSKFLTCSDD-GTIKIWDFRMPKEERVLRGHGWDVK 226 (464)
T ss_pred ------------------------hHHhhHhhhhhhheeccCCCCceeEEecCC-CeEEEEeccCCchhheeccCCCCcc
Confidence 233556666799999999999999999999 699999998876654 566777899
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceee
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHL 336 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~ 336 (350)
+++|+|....||+++.|..|++||.+++.+ ..+..|...|..+.|+|++++|++++ |....+++++.-.....+.+|.
T Consensus 227 svdWHP~kgLiasgskDnlVKlWDprSg~cl~tlh~HKntVl~~~f~~n~N~Llt~skD~~~kv~DiR~mkEl~~~r~Hk 306 (464)
T KOG0284|consen 227 SVDWHPTKGLIASGSKDNLVKLWDPRSGSCLATLHGHKNTVLAVKFNPNGNWLLTGSKDQSCKVFDIRTMKELFTYRGHK 306 (464)
T ss_pred eeccCCccceeEEccCCceeEeecCCCcchhhhhhhccceEEEEEEcCCCCeeEEccCCceEEEEehhHhHHHHHhhcch
Confidence 999999999999999999999999999998 56789999999999999999999988 6667777777444455777888
Q ss_pred cccccceeeccc
Q 018806 337 LPVDLPDIVSLT 348 (350)
Q Consensus 337 ~~v~~~~~~~~~ 348 (350)
..|....++++.
T Consensus 307 kdv~~~~WhP~~ 318 (464)
T KOG0284|consen 307 KDVTSLTWHPLN 318 (464)
T ss_pred hhheeecccccc
Confidence 888877776653
No 15
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.96 E-value=1e-28 Score=218.63 Aligned_cols=216 Identities=16% Similarity=0.250 Sum_probs=178.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCC----------------------------CCceeEecCCCCCCeeEEEE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSE----------------------------GKDACILTSDSQRDVKVLEW 152 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~----------------------------~~~~~~~~~~~~~~v~~~~~ 152 (350)
.|+|..|++|+.+||.|-.|-.|++|.+.... .........+|.++|..++|
T Consensus 380 ~v~ca~fSddssmlA~Gf~dS~i~~~Sl~p~kl~~lk~~~~l~~~d~~sad~~~~~~D~~~~~~~~~L~GH~GPVyg~sF 459 (707)
T KOG0263|consen 380 GVTCAEFSDDSSMLACGFVDSSVRVWSLTPKKLKKLKDASDLSNIDTESADVDVDMLDDDSSGTSRTLYGHSGPVYGCSF 459 (707)
T ss_pred cceeEeecCCcchhhccccccEEEEEecchhhhccccchhhhccccccccchhhhhccccCCceeEEeecCCCceeeeee
Confidence 69999999999999999999999999886210 01112223589999999999
Q ss_pred eeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe
Q 018806 153 RPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY 232 (350)
Q Consensus 153 sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~ 232 (350)
+|+.+.|++++.|+++|+|.+. .|.+.-.++||. .+|+.+.|+|.|-++|+++.
T Consensus 460 sPd~rfLlScSED~svRLWsl~-------------------------t~s~~V~y~GH~-~PVwdV~F~P~GyYFatas~ 513 (707)
T KOG0263|consen 460 SPDRRFLLSCSEDSSVRLWSLD-------------------------TWSCLVIYKGHL-APVWDVQFAPRGYYFATASH 513 (707)
T ss_pred cccccceeeccCCcceeeeecc-------------------------cceeEEEecCCC-cceeeEEecCCceEEEecCC
Confidence 9998888888889999999998 444556678886 79999999999999999999
Q ss_pred CCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEE
Q 018806 233 ESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMI 310 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l 310 (350)
| ++-++|........++ .+|...|.|+.|+|++.++++|+.|++|++||+.+|... .+.+|.++|++++|||+|++|
T Consensus 514 D-~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~L 592 (707)
T KOG0263|consen 514 D-QTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYL 592 (707)
T ss_pred C-ceeeeeecccCCchhhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceE
Confidence 9 6999999988777664 467899999999999999999999999999999999885 466999999999999999999
Q ss_pred EEEECCCeEEEEEEeCC--CCCCCceeeccccccee
Q 018806 311 LLAFAGSLTLGSIHFAS--KPPSLDAHLLPVDLPDI 344 (350)
Q Consensus 311 ~~~~~~~~~~~~~~~~~--~~~~~~~~~~~v~~~~~ 344 (350)
++|+.. ..+..|++.. ....+.+|...|....+
T Consensus 593 aSg~ed-~~I~iWDl~~~~~v~~l~~Ht~ti~SlsF 627 (707)
T KOG0263|consen 593 ASGDED-GLIKIWDLANGSLVKQLKGHTGTIYSLSF 627 (707)
T ss_pred eecccC-CcEEEEEcCCCcchhhhhcccCceeEEEE
Confidence 988622 2344455544 33477788777666555
No 16
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.96 E-value=1.1e-27 Score=210.85 Aligned_cols=199 Identities=18% Similarity=0.307 Sum_probs=170.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..++++++||||++||+|+.||+|+|||.. .+-+..++ ..|...|+.+.|+..|+.+++++-||+|+.||+.
T Consensus 351 ~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~--SgfC~vTF-teHts~Vt~v~f~~~g~~llssSLDGtVRAwDlk----- 422 (893)
T KOG0291|consen 351 DRITSLAYSPDGQLIATGAEDGKVKVWNTQ--SGFCFVTF-TEHTSGVTAVQFTARGNVLLSSSLDGTVRAWDLK----- 422 (893)
T ss_pred cceeeEEECCCCcEEEeccCCCcEEEEecc--CceEEEEe-ccCCCceEEEEEEecCCEEEEeecCCeEEeeeec-----
Confidence 369999999999999999999999999984 36676666 4899999999999999999999999999999998
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~ 258 (350)
+++..+++....+....+++..|.|..+.+|+.|.=.|.+|++++|+... +.+|.++|.
T Consensus 423 --------------------RYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs 482 (893)
T KOG0291|consen 423 --------------------RYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVS 482 (893)
T ss_pred --------------------ccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcce
Confidence 44456667776666788999999999999999886679999999999876 557899999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeC
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFA 326 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~ 326 (350)
+++|+|+|..|++++.|++|++||+-.... .....+...+..++|+|+|+.|+++. ++.+.+|+....
T Consensus 483 ~l~f~~~~~~LaS~SWDkTVRiW~if~s~~~vEtl~i~sdvl~vsfrPdG~elaVaTldgqItf~d~~~~ 552 (893)
T KOG0291|consen 483 GLSFSPDGSLLASGSWDKTVRIWDIFSSSGTVETLEIRSDVLAVSFRPDGKELAVATLDGQITFFDIKEA 552 (893)
T ss_pred eeEEccccCeEEeccccceEEEEEeeccCceeeeEeeccceeEEEEcCCCCeEEEEEecceEEEEEhhhc
Confidence 999999999999999999999999965522 33344566789999999999999997 777777776544
No 17
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.96 E-value=1.3e-28 Score=202.56 Aligned_cols=217 Identities=16% Similarity=0.276 Sum_probs=173.0
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+|+++.|+++|.++++|+.+|.|++|+.+ ...+..+...|...|++++|+|++..+++++.|++|+|||......
T Consensus 138 Ds~Vr~m~ws~~g~wmiSgD~gG~iKyWqpn---mnnVk~~~ahh~eaIRdlafSpnDskF~t~SdDg~ikiWdf~~~ke 214 (464)
T KOG0284|consen 138 DSPVRTMKWSHNGTWMISGDKGGMIKYWQPN---MNNVKIIQAHHAEAIRDLAFSPNDSKFLTCSDDGTIKIWDFRMPKE 214 (464)
T ss_pred cccceeEEEccCCCEEEEcCCCceEEecccc---hhhhHHhhHhhhhhhheeccCCCCceeEEecCCCeEEEEeccCCch
Confidence 3479999999999999999999999999985 3333444334668999999999999999999999999999985443
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
. ..+.+|. -.|.++.|+|.-..|++++.|+ .|++||.+++.+.. +..|+..|
T Consensus 215 e-------------------------~vL~GHg-wdVksvdWHP~kgLiasgskDn-lVKlWDprSg~cl~tlh~HKntV 267 (464)
T KOG0284|consen 215 E-------------------------RVLRGHG-WDVKSVDWHPTKGLIASGSKDN-LVKLWDPRSGSCLATLHGHKNTV 267 (464)
T ss_pred h-------------------------heeccCC-CCcceeccCCccceeEEccCCc-eeEeecCCCcchhhhhhhccceE
Confidence 2 2356775 7999999999999999999996 99999999998875 66788999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC-CC-CCC-c
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS-KP-PSL-D 333 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~-~~-~~~-~ 333 (350)
..+.|+|++++|++++.|..++++|+++.+. ..+.+|...++++.|+|-..-|++.++.+..+.-|.+.. .+ ..+ .
T Consensus 268 l~~~f~~n~N~Llt~skD~~~kv~DiR~mkEl~~~r~Hkkdv~~~~WhP~~~~lftsgg~Dgsvvh~~v~~~~p~~~i~~ 347 (464)
T KOG0284|consen 268 LAVKFNPNGNWLLTGSKDQSCKVFDIRTMKELFTYRGHKKDVTSLTWHPLNESLFTSGGSDGSVVHWVVGLEEPLGEIPP 347 (464)
T ss_pred EEEEEcCCCCeeEEccCCceEEEEehhHhHHHHHhhcchhhheeeccccccccceeeccCCCceEEEeccccccccCCCc
Confidence 9999999999999999999999999996655 567789999999999997776666554444444444442 22 122 3
Q ss_pred eeecccccceee
Q 018806 334 AHLLPVDLPDIV 345 (350)
Q Consensus 334 ~~~~~v~~~~~~ 345 (350)
+|...|-....+
T Consensus 348 AHd~~iwsl~~h 359 (464)
T KOG0284|consen 348 AHDGEIWSLAYH 359 (464)
T ss_pred ccccceeeeecc
Confidence 666555444443
No 18
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.96 E-value=6.1e-28 Score=195.92 Aligned_cols=215 Identities=19% Similarity=0.260 Sum_probs=180.7
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
|.+++|+..|++||+++.|-.+++||++.. .++.. ...+|...|.+++|-|.|.++++++.|.+|+.|++.++
T Consensus 153 v~di~~~a~Gk~l~tcSsDl~~~LWd~~~~-~~c~k-s~~gh~h~vS~V~f~P~gd~ilS~srD~tik~We~~tg----- 225 (406)
T KOG0295|consen 153 VFDISFDASGKYLATCSSDLSAKLWDFDTF-FRCIK-SLIGHEHGVSSVFFLPLGDHILSCSRDNTIKAWECDTG----- 225 (406)
T ss_pred eeEEEEecCccEEEecCCccchhheeHHHH-HHHHH-HhcCcccceeeEEEEecCCeeeecccccceeEEecccc-----
Confidence 889999999999999999999999999632 23333 33589999999999999999999999999999999843
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEE
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSIL 260 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~ 260 (350)
.++.++.+|. ..|..++.+.||..+++++.|. ++++|-+.++++.. +..|..+|.++
T Consensus 226 --------------------~cv~t~~~h~-ewvr~v~v~~DGti~As~s~dq-tl~vW~~~t~~~k~~lR~hEh~vEci 283 (406)
T KOG0295|consen 226 --------------------YCVKTFPGHS-EWVRMVRVNQDGTIIASCSNDQ-TLRVWVVATKQCKAELREHEHPVECI 283 (406)
T ss_pred --------------------eeEEeccCch-HhEEEEEecCCeeEEEecCCCc-eEEEEEeccchhhhhhhccccceEEE
Confidence 3467788887 6999999999999999999995 99999999997754 66788999999
Q ss_pred EEcCC---------------CCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 261 KWSPT---------------GDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 261 ~~sp~---------------g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
+|.|. ++++++++.|++|++||+.++.+ .++.+|..+|..++|+|.|+||+++. ++...+|++
T Consensus 284 ~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg~cL~tL~ghdnwVr~~af~p~Gkyi~ScaDDktlrvwdl 363 (406)
T KOG0295|consen 284 AWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTGMCLFTLVGHDNWVRGVAFSPGGKYILSCADDKTLRVWDL 363 (406)
T ss_pred EecccccCcchhhccCCCCCccEEEeecccceEEEEeccCCeEEEEEecccceeeeeEEcCCCeEEEEEecCCcEEEEEe
Confidence 99763 25889999999999999999998 67889999999999999999999887 555666666
Q ss_pred EeCCCCCCCceeecccccceee
Q 018806 324 HFASKPPSLDAHLLPVDLPDIV 345 (350)
Q Consensus 324 ~~~~~~~~~~~~~~~v~~~~~~ 345 (350)
+...+...+.+|..-+....+.
T Consensus 364 ~~~~cmk~~~ah~hfvt~lDfh 385 (406)
T KOG0295|consen 364 KNLQCMKTLEAHEHFVTSLDFH 385 (406)
T ss_pred ccceeeeccCCCcceeEEEecC
Confidence 6655566777777666555443
No 19
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.96 E-value=1.5e-27 Score=189.05 Aligned_cols=208 Identities=13% Similarity=0.197 Sum_probs=173.1
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEe
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWR 153 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~s 153 (350)
+..+.||.++ |+.+.|+|+|.++|+|+.|..|.+|++.. ..+..-.+ .+|.+.|..+.|.
T Consensus 40 ~m~l~gh~ge------------------I~~~~F~P~gs~~aSgG~Dr~I~LWnv~g-dceN~~~l-kgHsgAVM~l~~~ 99 (338)
T KOG0265|consen 40 IMLLPGHKGE------------------IYTIKFHPDGSCFASGGSDRAIVLWNVYG-DCENFWVL-KGHSGAVMELHGM 99 (338)
T ss_pred hhhcCCCcce------------------EEEEEECCCCCeEeecCCcceEEEEeccc-cccceeee-ccccceeEeeeec
Confidence 5667788777 78889999999999999999999999753 23333333 5899999999999
Q ss_pred eCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC
Q 018806 154 PNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYE 233 (350)
Q Consensus 154 p~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d 233 (350)
+|++.+++++.|++++.||.++++... .+++|. .-|.++.-+.-|..+++.+.|
T Consensus 100 ~d~s~i~S~gtDk~v~~wD~~tG~~~r-------------------------k~k~h~-~~vNs~~p~rrg~~lv~Sgsd 153 (338)
T KOG0265|consen 100 RDGSHILSCGTDKTVRGWDAETGKRIR-------------------------KHKGHT-SFVNSLDPSRRGPQLVCSGSD 153 (338)
T ss_pred cCCCEEEEecCCceEEEEecccceeee-------------------------hhcccc-ceeeecCccccCCeEEEecCC
Confidence 999999999999999999999766543 356665 577777755567777666666
Q ss_pred CCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEE
Q 018806 234 SSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILL 312 (350)
Q Consensus 234 ~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~ 312 (350)
+|++++||+++.........+..++++.|..++..+.+|+-|+.|++||++.++. ..+.+|..+|+.+..+|+|.++.+
T Consensus 154 D~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~lls 233 (338)
T KOG0265|consen 154 DGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLS 233 (338)
T ss_pred CceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccCcceEEeecccCceeeEEeccCCCcccc
Confidence 6899999999998888888889999999999999999999999999999998887 567899999999999999999997
Q ss_pred EE-CCCeEEEEEEeCC
Q 018806 313 AF-AGSLTLGSIHFAS 327 (350)
Q Consensus 313 ~~-~~~~~~~~~~~~~ 327 (350)
-+ +....+|.++-+.
T Consensus 234 nsMd~tvrvwd~rp~~ 249 (338)
T KOG0265|consen 234 NSMDNTVRVWDVRPFA 249 (338)
T ss_pred ccccceEEEEEecccC
Confidence 65 6656666666553
No 20
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.96 E-value=2.6e-27 Score=187.17 Aligned_cols=182 Identities=19% Similarity=0.294 Sum_probs=160.9
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEee-CCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRP-NGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+.|+.|-+|+ +|+++|.|.+..+||++. ++....+ .+|.+.|.+++++| +++.+++++.|+..++||++.+.
T Consensus 148 lScC~f~dD~-~ilT~SGD~TCalWDie~--g~~~~~f-~GH~gDV~slsl~p~~~ntFvSg~cD~~aklWD~R~~~--- 220 (343)
T KOG0286|consen 148 LSCCRFLDDN-HILTGSGDMTCALWDIET--GQQTQVF-HGHTGDVMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQ--- 220 (343)
T ss_pred eEEEEEcCCC-ceEecCCCceEEEEEccc--ceEEEEe-cCCcccEEEEecCCCCCCeEEecccccceeeeeccCcc---
Confidence 8888888765 577999999999999964 6665655 69999999999999 88899999999999999999554
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC---CCe
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF---GGL 257 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~---~~v 257 (350)
+.+++.+|. ..|.++.|.|+|.-+++++.| +++++||++..+...+..+. .+|
T Consensus 221 ----------------------c~qtF~ghe-sDINsv~ffP~G~afatGSDD-~tcRlyDlRaD~~~a~ys~~~~~~gi 276 (343)
T KOG0286|consen 221 ----------------------CVQTFEGHE-SDINSVRFFPSGDAFATGSDD-ATCRLYDLRADQELAVYSHDSIICGI 276 (343)
T ss_pred ----------------------eeEeecccc-cccceEEEccCCCeeeecCCC-ceeEEEeecCCcEEeeeccCcccCCc
Confidence 356688886 899999999999999999999 79999999998887777654 679
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.+++||..|++|++|..|.++.+||.-.++. ..+.+|++.|+++..+|||.-|++|+
T Consensus 277 tSv~FS~SGRlLfagy~d~~c~vWDtlk~e~vg~L~GHeNRvScl~~s~DG~av~TgS 334 (343)
T KOG0286|consen 277 TSVAFSKSGRLLFAGYDDFTCNVWDTLKGERVGVLAGHENRVSCLGVSPDGMAVATGS 334 (343)
T ss_pred eeEEEcccccEEEeeecCCceeEeeccccceEEEeeccCCeeEEEEECCCCcEEEecc
Confidence 9999999999999999999999999877776 56789999999999999999999885
No 21
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.96 E-value=4.2e-27 Score=212.00 Aligned_cols=213 Identities=23% Similarity=0.363 Sum_probs=173.6
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|.++.|+++|+.+++++.++.+++|+...........+ .+|...|..++|+|+++.+++++.|++++|||+....
T Consensus 159 ~~sv~~~~fs~~g~~l~~~~~~~~i~~~~~~~~~~~~~~~l-~~h~~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~- 236 (456)
T KOG0266|consen 159 CPSVTCVDFSPDGRALAAASSDGLIRIWKLEGIKSNLLREL-SGHTRGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDG- 236 (456)
T ss_pred cCceEEEEEcCCCCeEEEccCCCcEEEeecccccchhhccc-cccccceeeeEECCCCcEEEEecCCceEEEeeccCCC-
Confidence 35799999999999999999999999999953221133333 5799999999999999888888889999999995332
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
.+.+++.+|. ..|++++|+|+|+.+++++.| ++|++||++++++.. +..|...|
T Consensus 237 -----------------------~~~~~l~gH~-~~v~~~~f~p~g~~i~Sgs~D-~tvriWd~~~~~~~~~l~~hs~~i 291 (456)
T KOG0266|consen 237 -----------------------RNLKTLKGHS-TYVTSVAFSPDGNLLVSGSDD-GTVRIWDVRTGECVRKLKGHSDGI 291 (456)
T ss_pred -----------------------eEEEEecCCC-CceEEEEecCCCCEEEEecCC-CcEEEEeccCCeEEEeeeccCCce
Confidence 2466788887 799999999999999999999 699999999988765 55688999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce---eccccCCC--CeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCC
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS---EPWSSTSG--FVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPS 331 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~---~~~~~~~~--~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~ 331 (350)
.+++|+++|++|++++.|+.|+|||+.++.. ..+..+.. +++.+.|+|++++|+++. ++...+|++........
T Consensus 292 s~~~f~~d~~~l~s~s~d~~i~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d~~~~~w~l~~~~~~~~ 371 (456)
T KOG0266|consen 292 SGLAFSPDGNLLVSASYDGTIRVWDLETGSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLDRTLKLWDLRSGKSVGT 371 (456)
T ss_pred EEEEECCCCCEEEEcCCCccEEEEECCCCceeeeecccCCCCCCceeEEEECCCCcEEEEecCCCeEEEEEccCCcceee
Confidence 9999999999999999999999999999993 34444444 599999999999999988 44566666655444455
Q ss_pred Cceeecc
Q 018806 332 LDAHLLP 338 (350)
Q Consensus 332 ~~~~~~~ 338 (350)
+.+|...
T Consensus 372 ~~~~~~~ 378 (456)
T KOG0266|consen 372 YTGHSNL 378 (456)
T ss_pred ecccCCc
Confidence 5566553
No 22
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.95 E-value=1.3e-26 Score=208.91 Aligned_cols=217 Identities=21% Similarity=0.354 Sum_probs=171.3
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|.+++|+|+++++++++.|++++|||+. ..+.....+ .+|...|++++|+|+|+.+++++.|++|+|||++...
T Consensus 203 ~~~v~~~~fs~d~~~l~s~s~D~tiriwd~~-~~~~~~~~l-~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~~~~- 279 (456)
T KOG0266|consen 203 TRGVSDVAFSPDGSYLLSGSDDKTLRIWDLK-DDGRNLKTL-KGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVRTGE- 279 (456)
T ss_pred ccceeeeEECCCCcEEEEecCCceEEEeecc-CCCeEEEEe-cCCCCceEEEEecCCCCEEEEecCCCcEEEEeccCCe-
Confidence 4579999999999999999999999999993 234555555 5999999999999999788888889999999999422
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--e-eeeecCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG--T-PIRRGFG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~--~-~~~~~~~ 255 (350)
+...+.+|. ..|++++|+++++.|++++.| |.|++||+.++.. . .+..+..
T Consensus 280 ------------------------~~~~l~~hs-~~is~~~f~~d~~~l~s~s~d-~~i~vwd~~~~~~~~~~~~~~~~~ 333 (456)
T KOG0266|consen 280 ------------------------CVRKLKGHS-DGISGLAFSPDGNLLVSASYD-GTIRVWDLETGSKLCLKLLSGAEN 333 (456)
T ss_pred ------------------------EEEeeeccC-CceEEEEECCCCCEEEEcCCC-ccEEEEECCCCceeeeecccCCCC
Confidence 356688887 699999999999999999988 7999999999983 2 3334433
Q ss_pred --CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCC---CeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC-
Q 018806 256 --GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSG---FVTGATWDPEGRMILLAFAGSLTLGSIHFASK- 328 (350)
Q Consensus 256 --~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~---~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~- 328 (350)
.+++++|+|++++++++..|+.+++||+..++. ..+..|.. .+.+...++.|+++++++.. ..+..|+....
T Consensus 334 ~~~~~~~~fsp~~~~ll~~~~d~~~~~w~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~i~sg~~d-~~v~~~~~~s~~ 412 (456)
T KOG0266|consen 334 SAPVTSVQFSPNGKYLLSASLDRTLKLWDLRSGKSVGTYTGHSNLVRCIFSPTLSTGGKLIYSGSED-GSVYVWDSSSGG 412 (456)
T ss_pred CCceeEEEECCCCcEEEEecCCCeEEEEEccCCcceeeecccCCcceeEecccccCCCCeEEEEeCC-ceEEEEeCCccc
Confidence 589999999999999999999999999998877 44555554 34566678899999988633 34555555433
Q ss_pred -CCCCcee-ecccccceee
Q 018806 329 -PPSLDAH-LLPVDLPDIV 345 (350)
Q Consensus 329 -~~~~~~~-~~~v~~~~~~ 345 (350)
...+.+| ..++....++
T Consensus 413 ~~~~l~~h~~~~~~~~~~~ 431 (456)
T KOG0266|consen 413 ILQRLEGHSKAAVSDLSSH 431 (456)
T ss_pred hhhhhcCCCCCceeccccC
Confidence 3477778 5555544443
No 23
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.95 E-value=2.4e-27 Score=192.19 Aligned_cols=207 Identities=14% Similarity=0.183 Sum_probs=173.8
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|.|+++.|-.+++++|+.|++++|||+.+ ++....+ .+|...|..+++|+--.++++++.|+.|+.||++..+.
T Consensus 153 WVr~vavdP~n~wf~tgs~DrtikIwDlat--g~Lkltl-tGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkv-- 227 (460)
T KOG0285|consen 153 WVRSVAVDPGNEWFATGSADRTIKIWDLAT--GQLKLTL-TGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKV-- 227 (460)
T ss_pred eEEEEeeCCCceeEEecCCCceeEEEEccc--CeEEEee-cchhheeeeeeecccCceEEEecCCCeeEEEechhhhh--
Confidence 599999999999999999999999999964 6666666 48999999999999888999999999999999994433
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSI 259 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~ 259 (350)
++.+.||- +.|.+++.+|.-..|++++.|. ++++||+++..... +.+|..+|.+
T Consensus 228 -----------------------IR~YhGHl-S~V~~L~lhPTldvl~t~grDs-t~RvWDiRtr~~V~~l~GH~~~V~~ 282 (460)
T KOG0285|consen 228 -----------------------IRHYHGHL-SGVYCLDLHPTLDVLVTGGRDS-TIRVWDIRTRASVHVLSGHTNPVAS 282 (460)
T ss_pred -----------------------HHHhcccc-ceeEEEeccccceeEEecCCcc-eEEEeeecccceEEEecCCCCccee
Confidence 44467776 7999999999999999999996 99999999987765 5568999999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCC--CCCceee
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKP--PSLDAHL 336 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~--~~~~~~~ 336 (350)
+.+.|....+++|+.|++|++||++.++. ..+..|...+.+++.+|....+++++.+. +..|++.... ..+.+|.
T Consensus 283 V~~~~~dpqvit~S~D~tvrlWDl~agkt~~tlt~hkksvral~lhP~e~~fASas~dn--ik~w~~p~g~f~~nlsgh~ 360 (460)
T KOG0285|consen 283 VMCQPTDPQVITGSHDSTVRLWDLRAGKTMITLTHHKKSVRALCLHPKENLFASASPDN--IKQWKLPEGEFLQNLSGHN 360 (460)
T ss_pred EEeecCCCceEEecCCceEEEeeeccCceeEeeecccceeeEEecCCchhhhhccCCcc--ceeccCCccchhhcccccc
Confidence 99999888999999999999999999987 56788999999999999988888776443 4455554432 2455555
Q ss_pred ccc
Q 018806 337 LPV 339 (350)
Q Consensus 337 ~~v 339 (350)
.-+
T Consensus 361 ~ii 363 (460)
T KOG0285|consen 361 AII 363 (460)
T ss_pred cee
Confidence 443
No 24
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.95 E-value=2.4e-27 Score=199.06 Aligned_cols=224 Identities=15% Similarity=0.202 Sum_probs=176.5
Q ss_pred cccchhhhhhhhhhccccccCCCCcCCCCccCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCee
Q 018806 70 GEGLFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVK 148 (350)
Q Consensus 70 ~~~~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~ 148 (350)
++.++.++.||... |+++.|.| .+++|++++.|+.|+||++-. .+.++..+ .+|..+|.
T Consensus 203 Pkk~~~~~~gH~kg------------------vsai~~fp~~~hLlLS~gmD~~vklW~vy~-~~~~lrtf-~gH~k~Vr 262 (503)
T KOG0282|consen 203 PKKLSHNLSGHTKG------------------VSAIQWFPKKGHLLLSGGMDGLVKLWNVYD-DRRCLRTF-KGHRKPVR 262 (503)
T ss_pred cHhheeeccCCccc------------------cchhhhccceeeEEEecCCCceEEEEEEec-Ccceehhh-hcchhhhh
Confidence 55566777777666 77788888 889999999999999999964 45555544 69999999
Q ss_pred EEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccc------ccccc---eecCCCCCceEEeeec--------cCCC
Q 018806 149 VLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGA------ASFLG---ALSRGPGTRWTLVDFL--------RSQN 211 (350)
Q Consensus 149 ~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~------~~~~~---~~~~~~~~~~~~~~~~--------~~~~ 211 (350)
+++|+++|..+++++.|+.+++||++++.....+..+. +.+.. -++.+.++++..|+.- ..|
T Consensus 263 d~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~f~~~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~h- 341 (503)
T KOG0282|consen 263 DASFNNCGTSFLSASFDRFLKLWDTETGQVLSRFHLDKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRH- 341 (503)
T ss_pred hhhccccCCeeeeeecceeeeeeccccceEEEEEecCCCceeeecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhh-
Confidence 99999999999999999999999999888777665542 22322 2556667777777642 334
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--------------------------------------------
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-------------------------------------------- 247 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-------------------------------------------- 247 (350)
-+.|..+.|-++|+++++++.| ++++||+.+.+..
T Consensus 342 Lg~i~~i~F~~~g~rFissSDd-ks~riWe~~~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQs~dN~i~ifs~~~~~r~ 420 (503)
T KOG0282|consen 342 LGAILDITFVDEGRRFISSSDD-KSVRIWENRIPVPIKNIADPEMHTMPCLTLHPNGKWFAAQSMDNYIAIFSTVPPFRL 420 (503)
T ss_pred hhheeeeEEccCCceEeeeccC-ccEEEEEcCCCccchhhcchhhccCcceecCCCCCeehhhccCceEEEEeccccccc
Confidence 4789999999999999999999 5999999876510
Q ss_pred ---eeeeec--CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 248 ---TPIRRG--FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 248 ---~~~~~~--~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
..+.+| .+.-..+.|||||++|++|+.||.+.+||.++-+. ..+..|..++..+.|+|.....+++++
T Consensus 421 nkkK~feGh~vaGys~~v~fSpDG~~l~SGdsdG~v~~wdwkt~kl~~~lkah~~~ci~v~wHP~e~Skvat~~ 494 (503)
T KOG0282|consen 421 NKKKRFEGHSVAGYSCQVDFSPDGRTLCSGDSDGKVNFWDWKTTKLVSKLKAHDQPCIGVDWHPVEPSKVATCG 494 (503)
T ss_pred CHhhhhcceeccCceeeEEEcCCCCeEEeecCCccEEEeechhhhhhhccccCCcceEEEEecCCCcceeEecc
Confidence 011122 13456799999999999999999999999999887 567889999999999998776655553
No 25
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.95 E-value=5.6e-26 Score=175.83 Aligned_cols=224 Identities=14% Similarity=0.244 Sum_probs=170.6
Q ss_pred hhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC
Q 018806 76 TLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN 155 (350)
Q Consensus 76 ~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 155 (350)
..+.+++.-++.+-+|+ ..|..+.+.|+++.||+++. ..|++||++..+...+..+ .+|...|+++.|.-+
T Consensus 24 fWqa~tG~C~rTiqh~d-------sqVNrLeiTpdk~~LAaa~~-qhvRlyD~~S~np~Pv~t~-e~h~kNVtaVgF~~d 94 (311)
T KOG0315|consen 24 FWQALTGICSRTIQHPD-------SQVNRLEITPDKKDLAAAGN-QHVRLYDLNSNNPNPVATF-EGHTKNVTAVGFQCD 94 (311)
T ss_pred eeehhcCeEEEEEecCc-------cceeeEEEcCCcchhhhccC-CeeEEEEccCCCCCceeEE-eccCCceEEEEEeec
Confidence 34445555555555554 34999999999999998765 4699999987555444444 689999999999999
Q ss_pred CCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC
Q 018806 156 GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS 235 (350)
Q Consensus 156 ~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g 235 (350)
|+.+++++.||+++|||++....... ..+ ..+|+++..+|+...|+++..+ |
T Consensus 95 grWMyTgseDgt~kIWdlR~~~~qR~--------------------------~~~-~spVn~vvlhpnQteLis~dqs-g 146 (311)
T KOG0315|consen 95 GRWMYTGSEDGTVKIWDLRSLSCQRN--------------------------YQH-NSPVNTVVLHPNQTELISGDQS-G 146 (311)
T ss_pred CeEEEecCCCceEEEEeccCcccchh--------------------------ccC-CCCcceEEecCCcceEEeecCC-C
Confidence 99999999999999999995333222 222 2799999999999999999988 7
Q ss_pred eEEEEeCCCCCcee--eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-------eccccCCCCeEEEEEcCC
Q 018806 236 SFTIWDVAQGLGTP--IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-------EPWSSTSGFVTGATWDPE 306 (350)
Q Consensus 236 ~i~iwd~~~~~~~~--~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-------~~~~~~~~~v~~~~~s~~ 306 (350)
.|++||+....+.. +.+....+.++...|||+.++.+...|..++|++-+... .++..|.+.+..+.+|||
T Consensus 147 ~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd 226 (311)
T KOG0315|consen 147 NIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPD 226 (311)
T ss_pred cEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccEEEEEccCCCccccceEhhheecccceEEEEEECCC
Confidence 99999999876543 334457899999999999999999999999999976543 346689999999999999
Q ss_pred CCEEEEEE-CCCeEEEEEEeC-CCCCCCceee
Q 018806 307 GRMILLAF-AGSLTLGSIHFA-SKPPSLDAHL 336 (350)
Q Consensus 307 g~~l~~~~-~~~~~~~~~~~~-~~~~~~~~~~ 336 (350)
+++|++++ ++..++|..+-. .....+.+|+
T Consensus 227 ~k~lat~ssdktv~iwn~~~~~kle~~l~gh~ 258 (311)
T KOG0315|consen 227 VKYLATCSSDKTVKIWNTDDFFKLELVLTGHQ 258 (311)
T ss_pred CcEEEeecCCceEEEEecCCceeeEEEeecCC
Confidence 99999887 444444444322 1122445554
No 26
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.95 E-value=1.1e-25 Score=188.62 Aligned_cols=198 Identities=21% Similarity=0.391 Sum_probs=162.0
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCC--------------------------------------CceeEec
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEG--------------------------------------KDACILT 140 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~--------------------------------------~~~~~~~ 140 (350)
..+|.++.|+.+|++|++++.|+++.+||....+. ..+...+
T Consensus 276 kgPI~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~ 355 (524)
T KOG0273|consen 276 KGPIFSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTF 355 (524)
T ss_pred CCceEEEEEcCCCCEEEeccCCccEEEEeccCceEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceee
Confidence 45899999999999999999999999999832110 0111223
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
.+|.+.|.++.|+|.|..|++++.|++++||....... ...+..|. ..|..+.|
T Consensus 356 ~GH~g~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~-------------------------~~~l~~Hs-kei~t~~w 409 (524)
T KOG0273|consen 356 IGHHGEVNALKWNPTGSLLASCSDDGTLKIWSMGQSNS-------------------------VHDLQAHS-KEIYTIKW 409 (524)
T ss_pred ecccCceEEEEECCCCceEEEecCCCeeEeeecCCCcc-------------------------hhhhhhhc-cceeeEee
Confidence 47889999999999988888888899999999773332 34467776 68999999
Q ss_pred CCCC---------CeEEEEEeCCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 221 GPDG---------RYLASASYESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 221 sp~g---------~~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
+|.| ..|++++.| ++|++||+..+.+... ..|..+|++++|+|+|+++|+|+.||.|++|+.++++..+
T Consensus 410 sp~g~v~~n~~~~~~l~sas~d-stV~lwdv~~gv~i~~f~kH~~pVysvafS~~g~ylAsGs~dg~V~iws~~~~~l~~ 488 (524)
T KOG0273|consen 410 SPTGPVTSNPNMNLMLASASFD-STVKLWDVESGVPIHTLMKHQEPVYSVAFSPNGRYLASGSLDGCVHIWSTKTGKLVK 488 (524)
T ss_pred cCCCCccCCCcCCceEEEeecC-CeEEEEEccCCceeEeeccCCCceEEEEecCCCcEEEecCCCCeeEeccccchheeE
Confidence 9965 468899999 4999999999988764 4899999999999999999999999999999999999977
Q ss_pred cccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 291 WSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 291 ~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
.....+.|..++|+.+|..|..+. ++...+..+
T Consensus 489 s~~~~~~Ifel~Wn~~G~kl~~~~sd~~vcvldl 522 (524)
T KOG0273|consen 489 SYQGTGGIFELCWNAAGDKLGACASDGSVCVLDL 522 (524)
T ss_pred eecCCCeEEEEEEcCCCCEEEEEecCCCceEEEe
Confidence 777778899999999999988765 554444443
No 27
>PTZ00421 coronin; Provisional
Probab=99.94 E-value=1.1e-24 Score=195.81 Aligned_cols=202 Identities=15% Similarity=0.253 Sum_probs=152.1
Q ss_pred ccCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCC-----CceeEecCCCCCCeeEEEEeeCC-CeEEEEecCCcEEEE
Q 018806 99 EVDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEG-----KDACILTSDSQRDVKVLEWRPNG-GRSLSVGCKGGICIW 171 (350)
Q Consensus 99 ~~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~-----~~~~~~~~~~~~~v~~~~~sp~~-~~l~~~~~d~~v~iw 171 (350)
...|++++|+| ++++||+|+.|++|++|++..... ..... ..+|...|.+++|+|++ ..+++++.|++|+||
T Consensus 75 ~~~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~-L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIW 153 (493)
T PTZ00421 75 EGPIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVH-LQGHTKKVGIVSFHPSAMNVLASAGADMVVNVW 153 (493)
T ss_pred CCCEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEE-ecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEE
Confidence 45699999999 889999999999999999964211 12233 35899999999999986 467777779999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-e
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-I 250 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~ 250 (350)
|+..... ...+.+|. ..|.+++|+|+|+.|++++.| |+|++||+++++... +
T Consensus 154 Dl~tg~~-------------------------~~~l~~h~-~~V~sla~spdG~lLatgs~D-g~IrIwD~rsg~~v~tl 206 (493)
T PTZ00421 154 DVERGKA-------------------------VEVIKCHS-DQITSLEWNLDGSLLCTTSKD-KKLNIIDPRDGTIVSSV 206 (493)
T ss_pred ECCCCeE-------------------------EEEEcCCC-CceEEEEEECCCCEEEEecCC-CEEEEEECCCCcEEEEE
Confidence 9984322 33456665 689999999999999999999 699999999987654 3
Q ss_pred eecCCC-eEEEEEcCCCCEEEEEe----cCCeEEEEeCCCCce-eccc--cCCCCeEEEEEcCCCCEEEEEECCCeEEEE
Q 018806 251 RRGFGG-LSILKWSPTGDYFFAAK----FDGTFYLWETNTWTS-EPWS--STSGFVTGATWDPEGRMILLAFAGSLTLGS 322 (350)
Q Consensus 251 ~~~~~~-v~~~~~sp~g~~l~~~~----~d~~v~iwd~~~~~~-~~~~--~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~ 322 (350)
..|.+. ...+.|.+++..+++++ .|+.|++||+++... .... .....+....|++++++|++++.++..+..
T Consensus 207 ~~H~~~~~~~~~w~~~~~~ivt~G~s~s~Dr~VklWDlr~~~~p~~~~~~d~~~~~~~~~~d~d~~~L~lggkgDg~Iri 286 (493)
T PTZ00421 207 EAHASAKSQRCLWAKRKDLIITLGCSKSQQRQIMLWDTRKMASPYSTVDLDQSSALFIPFFDEDTNLLYIGSKGEGNIRC 286 (493)
T ss_pred ecCCCCcceEEEEcCCCCeEEEEecCCCCCCeEEEEeCCCCCCceeEeccCCCCceEEEEEcCCCCEEEEEEeCCCeEEE
Confidence 345443 45788999888777654 478999999987653 2221 233456667899999999988754555666
Q ss_pred EEeCCC
Q 018806 323 IHFASK 328 (350)
Q Consensus 323 ~~~~~~ 328 (350)
|++...
T Consensus 287 wdl~~~ 292 (493)
T PTZ00421 287 FELMNE 292 (493)
T ss_pred EEeeCC
Confidence 665543
No 28
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.94 E-value=4e-24 Score=167.49 Aligned_cols=194 Identities=18% Similarity=0.309 Sum_probs=158.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|++++|+|.|++||+||.|.++.||.-...+.++...+ .+|...|.+++|+++|++|++++.|+.|-||.+..
T Consensus 63 sVRsvAwsp~g~~La~aSFD~t~~Iw~k~~~efecv~~l-EGHEnEVK~Vaws~sG~~LATCSRDKSVWiWe~de----- 136 (312)
T KOG0645|consen 63 SVRSVAWSPHGRYLASASFDATVVIWKKEDGEFECVATL-EGHENEVKCVAWSASGNYLATCSRDKSVWIWEIDE----- 136 (312)
T ss_pred eeeeeeecCCCcEEEEeeccceEEEeecCCCceeEEeee-eccccceeEEEEcCCCCEEEEeeCCCeEEEEEecC-----
Confidence 499999999999999999999999999865555665555 59999999999999999999999999999999873
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC---c-eeeeecCCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL---G-TPIRRGFGG 256 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~---~-~~~~~~~~~ 256 (350)
++.+.+...++.|. ..|..+.|+|....|++++.|+ +|++|+-..+. + ..+.+|...
T Consensus 137 -----------------ddEfec~aVL~~Ht-qDVK~V~WHPt~dlL~S~SYDn-TIk~~~~~~dddW~c~~tl~g~~~T 197 (312)
T KOG0645|consen 137 -----------------DDEFECIAVLQEHT-QDVKHVIWHPTEDLLFSCSYDN-TIKVYRDEDDDDWECVQTLDGHENT 197 (312)
T ss_pred -----------------CCcEEEEeeecccc-ccccEEEEcCCcceeEEeccCC-eEEEEeecCCCCeeEEEEecCccce
Confidence 23566778899998 6999999999999999999996 99999877332 2 345567789
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
|.+++|++.|..|++++.|++|+||...+. -...|...++.++|. + ..|++++ ++.+.++.-.
T Consensus 198 VW~~~F~~~G~rl~s~sdD~tv~Iw~~~~~---~~~~~sr~~Y~v~W~-~-~~IaS~ggD~~i~lf~~s 261 (312)
T KOG0645|consen 198 VWSLAFDNIGSRLVSCSDDGTVSIWRLYTD---LSGMHSRALYDVPWD-N-GVIASGGGDDAIRLFKES 261 (312)
T ss_pred EEEEEecCCCceEEEecCCcceEeeeeccC---cchhcccceEeeeec-c-cceEeccCCCEEEEEEec
Confidence 999999999999999999999999986532 112456789999999 3 4566655 4445555444
No 29
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.94 E-value=2e-25 Score=172.87 Aligned_cols=214 Identities=17% Similarity=0.161 Sum_probs=173.1
Q ss_pred cccchhhhhhhhhhccccccCCCCcCC-------------------CC----ccCeeEEEEecCCCEEEEEECCCeEEEE
Q 018806 70 GEGLFSTLHGIISHSIKPLLHPDHVHL-------------------LP----EVDLQGVSWHQHKHIVAFISGSTQVIVR 126 (350)
Q Consensus 70 ~~~~~~~~~gh~~~~~~~~~~p~~~~~-------------------~~----~~~V~~v~~sp~g~~la~~s~d~~i~iw 126 (350)
+..++.++.||.+.++...+.....+- ++ ..-|.+++|+.|.++|++|+.++.++|+
T Consensus 48 tgdwigtfeghkgavw~~~l~~na~~aasaaadftakvw~a~tgdelhsf~hkhivk~~af~~ds~~lltgg~ekllrvf 127 (334)
T KOG0278|consen 48 TGDWIGTFEGHKGAVWSATLNKNATRAASAAADFTAKVWDAVTGDELHSFEHKHIVKAVAFSQDSNYLLTGGQEKLLRVF 127 (334)
T ss_pred CCCcEEeeeccCcceeeeecCchhhhhhhhcccchhhhhhhhhhhhhhhhhhhheeeeEEecccchhhhccchHHHhhhh
Confidence 466889999999888755443321111 11 1148999999999999999999999999
Q ss_pred EccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeee
Q 018806 127 DYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDF 206 (350)
Q Consensus 127 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 206 (350)
|++... ....-..+|.+.|..+-|....+.+++++.|++||+||.+++...+.+..
T Consensus 128 dln~p~--App~E~~ghtg~Ir~v~wc~eD~~iLSSadd~tVRLWD~rTgt~v~sL~~---------------------- 183 (334)
T KOG0278|consen 128 DLNRPK--APPKEISGHTGGIRTVLWCHEDKCILSSADDKTVRLWDHRTGTEVQSLEF---------------------- 183 (334)
T ss_pred hccCCC--CCchhhcCCCCcceeEEEeccCceEEeeccCCceEEEEeccCcEEEEEec----------------------
Confidence 997532 22333358999999999998878999998889999999997665544333
Q ss_pred ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCC
Q 018806 207 LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTW 286 (350)
Q Consensus 207 ~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~ 286 (350)
...|+++..+++|++|.++.. +.|.+||..+-....-..-...|.+..++|+...+++|++|..++.||..++
T Consensus 184 -----~s~VtSlEvs~dG~ilTia~g--ssV~Fwdaksf~~lKs~k~P~nV~SASL~P~k~~fVaGged~~~~kfDy~Tg 256 (334)
T KOG0278|consen 184 -----NSPVTSLEVSQDGRILTIAYG--SSVKFWDAKSFGLLKSYKMPCNVESASLHPKKEFFVAGGEDFKVYKFDYNTG 256 (334)
T ss_pred -----CCCCcceeeccCCCEEEEecC--ceeEEeccccccceeeccCccccccccccCCCceEEecCcceEEEEEeccCC
Confidence 258999999999998877644 4899999998877776667788999999999999999999999999999999
Q ss_pred ceecc--ccCCCCeEEEEEcCCCCEEEEEE
Q 018806 287 TSEPW--SSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 287 ~~~~~--~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+.... .+|.++|.++.|+|+|...++|+
T Consensus 257 eEi~~~nkgh~gpVhcVrFSPdGE~yAsGS 286 (334)
T KOG0278|consen 257 EEIGSYNKGHFGPVHCVRFSPDGELYASGS 286 (334)
T ss_pred ceeeecccCCCCceEEEEECCCCceeeccC
Confidence 88544 68999999999999999888775
No 30
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.94 E-value=2.2e-24 Score=175.49 Aligned_cols=245 Identities=18% Similarity=0.238 Sum_probs=175.9
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCcc------------------------CeeEEEEecCCCEEEEEECCCeEEEEEc
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEV------------------------DLQGVSWHQHKHIVAFISGSTQVIVRDY 128 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~------------------------~V~~v~~sp~g~~la~~s~d~~i~iw~~ 128 (350)
-...+.+|.+.++....+|.......+. .|+++.||.+|.+||+|..+|.|+||..
T Consensus 56 S~~tF~~H~~svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~~eltgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~ 135 (399)
T KOG0296|consen 56 SLVTFDKHTDSVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGELTGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKV 135 (399)
T ss_pred ceeehhhcCCceEEEEeCCCCceEEecCCCceEEEEEccCCcceeEecCCCCceEEEEEccCceEEEecCCCccEEEEEc
Confidence 3567889999999999999544333322 6999999999999999999999999999
Q ss_pred cCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccce----------ecCCCC
Q 018806 129 EDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGA----------LSRGPG 198 (350)
Q Consensus 129 ~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~----------~~~~~~ 198 (350)
.+ +.....+. .....|.-+.|+|.+..+++++.||.+-+|.+..+ ...++..+...+... +....+
T Consensus 136 st--g~~~~~~~-~e~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~-~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~d 211 (399)
T KOG0296|consen 136 ST--GGEQWKLD-QEVEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQ-ALCKVMSGHNSPCTCGEFIPDGKRILTGYDD 211 (399)
T ss_pred cc--CceEEEee-cccCceEEEEecccccEEEeecCCCcEEEEECCCc-ceeeEecCCCCCcccccccCCCceEEEEecC
Confidence 65 44444443 34567888999999777777777999999999854 333333333222221 222334
Q ss_pred CceEEeeeccCCC----------------------------------------------------------C---Cceee
Q 018806 199 TRWTLVDFLRSQN----------------------------------------------------------G---EQITA 217 (350)
Q Consensus 199 ~~~~~~~~~~~~~----------------------------------------------------------~---~~v~~ 217 (350)
+.++.|+...++. . ..|.+
T Consensus 212 gti~~Wn~ktg~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~esve~ 291 (399)
T KOG0296|consen 212 GTIIVWNPKTGQPLHKITQAEGLELPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDESVES 291 (399)
T ss_pred ceEEEEecCCCceeEEecccccCcCCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhhhhhh
Confidence 4455555322210 0 01111
Q ss_pred EEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCC
Q 018806 218 LSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSG 296 (350)
Q Consensus 218 ~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~ 296 (350)
+.|+..=...|+++.| |+|.|||+.....+.+..|..+|..+.|-+ ..+|++++.+|.|+.||.++|.++ .+.+|..
T Consensus 292 ~~~ss~lpL~A~G~vd-G~i~iyD~a~~~~R~~c~he~~V~~l~w~~-t~~l~t~c~~g~v~~wDaRtG~l~~~y~GH~~ 369 (399)
T KOG0296|consen 292 IPSSSKLPLAACGSVD-GTIAIYDLAASTLRHICEHEDGVTKLKWLN-TDYLLTACANGKVRQWDARTGQLKFTYTGHQM 369 (399)
T ss_pred cccccccchhhccccc-ceEEEEecccchhheeccCCCceEEEEEcC-cchheeeccCceEEeeeccccceEEEEecCch
Confidence 2222222345566667 688888877777777788888999999998 678999999999999999999984 6789999
Q ss_pred CeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 297 FVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
.|..++++|+++++++++ ++...++.+
T Consensus 370 ~Il~f~ls~~~~~vvT~s~D~~a~VF~v 397 (399)
T KOG0296|consen 370 GILDFALSPQKRLVVTVSDDNTALVFEV 397 (399)
T ss_pred heeEEEEcCCCcEEEEecCCCeEEEEec
Confidence 999999999999999988 554555543
No 31
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.94 E-value=7.7e-25 Score=192.70 Aligned_cols=223 Identities=18% Similarity=0.209 Sum_probs=175.7
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCcee-EecCCCCCCeeEEEEeeCCCe-EEEEecCCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDAC-ILTSDSQRDVKVLEWRPNGGR-SLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~-~~~~~~~~~v~~~~~sp~~~~-l~~~~~d~~v~iwd~~~~~~~ 179 (350)
|.++....+|-+||+|+.|.++++|.++.+..+..+ ....+|...|.+++++..+.. +++++.|.++++|++...+..
T Consensus 368 vlSL~~~~~g~llat~sKD~svilWr~~~~~~~~~~~a~~~gH~~svgava~~~~~asffvsvS~D~tlK~W~l~~s~~~ 447 (775)
T KOG0319|consen 368 VLSLDVWSSGDLLATGSKDKSVILWRLNNNCSKSLCVAQANGHTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPKSKET 447 (775)
T ss_pred eeeeeecccCcEEEEecCCceEEEEEecCCcchhhhhhhhcccccccceeeecccCccEEEEecCCceEEEecCCCcccc
Confidence 677775567899999999999999998543333222 222479999999999876554 555666999999999852221
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce-eeeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT-PIRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~~v~ 258 (350)
.... .+.+..+...| +..|++++.+|+.+.|++++.|+ +.++|++...... .+.+|..++.
T Consensus 448 ~~~~----------------~~~~~~t~~aH-dKdIN~Vaia~ndkLiAT~SqDk-taKiW~le~~~l~~vLsGH~RGvw 509 (775)
T KOG0319|consen 448 AFPI----------------VLTCRYTERAH-DKDINCVAIAPNDKLIATGSQDK-TAKIWDLEQLRLLGVLSGHTRGVW 509 (775)
T ss_pred cccc----------------eehhhHHHHhh-cccccceEecCCCceEEeccccc-ceeeecccCceEEEEeeCCccceE
Confidence 1100 00011123445 47999999999999999999996 9999999976654 4667899999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceee
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHL 336 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~ 336 (350)
++.|+|..+.+++++.|++|+||.+.+..+ .++.+|...|..+.|-.+|++|++++ ++-+.+|.++...+..++.+|.
T Consensus 510 ~V~Fs~~dq~laT~SgD~TvKIW~is~fSClkT~eGH~~aVlra~F~~~~~qliS~~adGliKlWnikt~eC~~tlD~H~ 589 (775)
T KOG0319|consen 510 CVSFSKNDQLLATCSGDKTVKIWSISTFSCLKTFEGHTSAVLRASFIRNGKQLISAGADGLIKLWNIKTNECEMTLDAHN 589 (775)
T ss_pred EEEeccccceeEeccCCceEEEEEeccceeeeeecCccceeEeeeeeeCCcEEEeccCCCcEEEEeccchhhhhhhhhcc
Confidence 999999999999999999999999999998 56778999999999999999999887 6667788887777888999998
Q ss_pred cccccc
Q 018806 337 LPVDLP 342 (350)
Q Consensus 337 ~~v~~~ 342 (350)
..|=..
T Consensus 590 DrvWaL 595 (775)
T KOG0319|consen 590 DRVWAL 595 (775)
T ss_pred ceeEEE
Confidence 887433
No 32
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.94 E-value=1.6e-24 Score=191.09 Aligned_cols=195 Identities=17% Similarity=0.293 Sum_probs=163.4
Q ss_pred cCeeEEEEecCCCEEEEEECC-CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGS-TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d-~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
.+|..++|+..|.+||.|+.. |.+-||++.. ...+.. .++|-..+++++++|||+.+++++.||+|+|||...+
T Consensus 308 ~~I~t~~~N~tGDWiA~g~~klgQLlVweWqs--EsYVlK-QQgH~~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~Sg-- 382 (893)
T KOG0291|consen 308 QKILTVSFNSTGDWIAFGCSKLGQLLVWEWQS--ESYVLK-QQGHSDRITSLAYSPDGQLIATGAEDGKVKVWNTQSG-- 382 (893)
T ss_pred ceeeEEEecccCCEEEEcCCccceEEEEEeec--cceeee-ccccccceeeEEECCCCcEEEeccCCCcEEEEeccCc--
Confidence 479999999999999998764 8999999954 332232 3579999999999999999999999999999999833
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCC--C
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFG--G 256 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~--~ 256 (350)
.|.-++..|+ +.|+.+.|+..|+.+++++.| |+|+.||+......+.+..+. .
T Consensus 383 -----------------------fC~vTFteHt-s~Vt~v~f~~~g~~llssSLD-GtVRAwDlkRYrNfRTft~P~p~Q 437 (893)
T KOG0291|consen 383 -----------------------FCFVTFTEHT-SGVTAVQFTARGNVLLSSSLD-GTVRAWDLKRYRNFRTFTSPEPIQ 437 (893)
T ss_pred -----------------------eEEEEeccCC-CceEEEEEEecCCEEEEeecC-CeEEeeeecccceeeeecCCCcee
Confidence 3566778887 799999999999999999999 899999999887766555444 4
Q ss_pred eEEEEEcCCCCEEEEEecCC-eEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDG-TFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~-~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
..+++..|.|..+++|+.|. .|++|++++|+.. .+.+|+++|.+++|+|+|..|++++ |+.+++|.+-
T Consensus 438 fscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS~SWDkTVRiW~if 508 (893)
T KOG0291|consen 438 FSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLASGSWDKTVRIWDIF 508 (893)
T ss_pred eeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEeccccceEEEEEee
Confidence 56888889999999998887 7999999999985 5779999999999999999999887 6555555443
No 33
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=2.3e-24 Score=175.28 Aligned_cols=193 Identities=16% Similarity=0.286 Sum_probs=162.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..|.++.|-|.|.+|++++.|.+|+.|++++ +.++..+ .+|...|..++.+.||..+++++.|.++++|-+......
T Consensus 194 h~vS~V~f~P~gd~ilS~srD~tik~We~~t--g~cv~t~-~~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k 270 (406)
T KOG0295|consen 194 HGVSSVFFLPLGDHILSCSRDNTIKAWECDT--GYCVKTF-PGHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCK 270 (406)
T ss_pred cceeeEEEEecCCeeeecccccceeEEeccc--ceeEEec-cCchHhEEEEEecCCeeEEEecCCCceEEEEEeccchhh
Confidence 3699999999999999999999999999964 7777776 489999999999999877777777999999999855332
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC---------------CCeEEEEEeCCCeEEEEeCCC
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD---------------GRYLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~---------------g~~l~~~~~d~g~i~iwd~~~ 244 (350)
..++.|. -.|.+++|-|. ++++.+++.| ++|++||+.+
T Consensus 271 -------------------------~~lR~hE-h~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrD-ktIk~wdv~t 323 (406)
T KOG0295|consen 271 -------------------------AELREHE-HPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRD-KTIKIWDVST 323 (406)
T ss_pred -------------------------hhhhccc-cceEEEEecccccCcchhhccCCCCCccEEEeeccc-ceEEEEeccC
Confidence 2245554 46777777552 3588999999 5999999999
Q ss_pred CCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEE
Q 018806 245 GLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLG 321 (350)
Q Consensus 245 ~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~ 321 (350)
+.+.. +.+|..+|..++|+|-|+||+++.+|+++++||++++++ ..+..|...++++.|+.+-.++++|+ +....+|
T Consensus 324 g~cL~tL~ghdnwVr~~af~p~Gkyi~ScaDDktlrvwdl~~~~cmk~~~ah~hfvt~lDfh~~~p~VvTGsVdqt~Kvw 403 (406)
T KOG0295|consen 324 GMCLFTLVGHDNWVRGVAFSPGGKYILSCADDKTLRVWDLKNLQCMKTLEAHEHFVTSLDFHKTAPYVVTGSVDQTVKVW 403 (406)
T ss_pred CeEEEEEecccceeeeeEEcCCCeEEEEEecCCcEEEEEeccceeeeccCCCcceeEEEecCCCCceEEeccccceeeee
Confidence 98764 667899999999999999999999999999999999998 56778999999999999999999886 5545554
Q ss_pred E
Q 018806 322 S 322 (350)
Q Consensus 322 ~ 322 (350)
+
T Consensus 404 E 404 (406)
T KOG0295|consen 404 E 404 (406)
T ss_pred e
Confidence 3
No 34
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.93 E-value=1.4e-24 Score=169.20 Aligned_cols=214 Identities=19% Similarity=0.236 Sum_probs=165.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCC-CeEEEEecCCcEEEEecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNG-GRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
.|.+|+|+.+|..||+|+.|+++.+|+++... ........+|.+.|-.++|+|.. ..+++++.|++|++||++..+..
T Consensus 22 ~v~Sv~wn~~g~~lasgs~dktv~v~n~e~~r-~~~~~~~~gh~~svdql~w~~~~~d~~atas~dk~ir~wd~r~~k~~ 100 (313)
T KOG1407|consen 22 KVHSVAWNCDGTKLASGSFDKTVSVWNLERDR-FRKELVYRGHTDSVDQLCWDPKHPDLFATASGDKTIRIWDIRSGKCT 100 (313)
T ss_pred cceEEEEcccCceeeecccCCceEEEEecchh-hhhhhcccCCCcchhhheeCCCCCcceEEecCCceEEEEEeccCcEE
Confidence 38999999999999999999999999997531 11222234788899999998764 45666777999999999966655
Q ss_pred ceeeccc------ccccce-e-cCCCCCc-------------------------------------------------eE
Q 018806 180 ASVRSGA------ASFLGA-L-SRGPGTR-------------------------------------------------WT 202 (350)
Q Consensus 180 ~~~~~~~------~~~~~~-~-~~~~~~~-------------------------------------------------~~ 202 (350)
..+.... +++.+. + ..+.++. ++
T Consensus 101 ~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsypsLk 180 (313)
T KOG1407|consen 101 ARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYPSLK 180 (313)
T ss_pred EEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEeccccc
Confidence 5543321 111111 1 1111111 01
Q ss_pred EeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEE
Q 018806 203 LVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLW 281 (350)
Q Consensus 203 ~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iw 281 (350)
.++.++.|. ....++.|+|+|+++|+|+.|. .+.+||++..-+.+. ..+.-+|..+.||.||++||++++|..|-|=
T Consensus 181 pv~si~AH~-snCicI~f~p~GryfA~GsADA-lvSLWD~~ELiC~R~isRldwpVRTlSFS~dg~~lASaSEDh~IDIA 258 (313)
T KOG1407|consen 181 PVQSIKAHP-SNCICIEFDPDGRYFATGSADA-LVSLWDVDELICERCISRLDWPVRTLSFSHDGRMLASASEDHFIDIA 258 (313)
T ss_pred cccccccCC-cceEEEEECCCCceEeeccccc-eeeccChhHhhhheeeccccCceEEEEeccCcceeeccCccceEEeE
Confidence 233566775 6888999999999999999995 999999998777664 4578899999999999999999999999999
Q ss_pred eCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 282 ETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 282 d~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
++++|....-..+.++-..++|+|...+||++++..
T Consensus 259 ~vetGd~~~eI~~~~~t~tVAWHPk~~LLAyA~ddk 294 (313)
T KOG1407|consen 259 EVETGDRVWEIPCEGPTFTVAWHPKRPLLAYACDDK 294 (313)
T ss_pred ecccCCeEEEeeccCCceeEEecCCCceeeEEecCC
Confidence 999999877777888999999999999999998443
No 35
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.93 E-value=5.7e-24 Score=180.62 Aligned_cols=244 Identities=16% Similarity=0.240 Sum_probs=176.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC----CcEEEEecC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK----GGICIWAPS 174 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d----~~v~iwd~~ 174 (350)
..+|+-..+||.|-|+|+|...|+|+|||....+- .+...+....++|..++|++++++++++|.. |.+.+||..
T Consensus 59 ~~~vtVAkySPsG~yiASGD~sG~vRIWdtt~~~h-iLKnef~v~aG~I~Di~Wd~ds~RI~avGEGrerfg~~F~~DSG 137 (603)
T KOG0318|consen 59 AHQVTVAKYSPSGFYIASGDVSGKVRIWDTTQKEH-ILKNEFQVLAGPIKDISWDFDSKRIAAVGEGRERFGHVFLWDSG 137 (603)
T ss_pred cceeEEEEeCCCceEEeecCCcCcEEEEeccCcce-eeeeeeeecccccccceeCCCCcEEEEEecCccceeEEEEecCC
Confidence 45689999999999999999999999999863322 2222223467899999999999999998874 678888875
Q ss_pred C-----CCCCceeecccccccce--ec-CCCCC--------ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEE
Q 018806 175 Y-----PGNAASVRSGAASFLGA--LS-RGPGT--------RWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFT 238 (350)
Q Consensus 175 ~-----~~~~~~~~~~~~~~~~~--~~-~~~~~--------~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~ 238 (350)
. .++.+.+....+.+... +. .+.|. .++...+++.|+ .-|.++.|+|||.++++++.| |++.
T Consensus 138 ~SvGei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~Hs-kFV~~VRysPDG~~Fat~gsD-gki~ 215 (603)
T KOG0318|consen 138 NSVGEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHS-KFVNCVRYSPDGSRFATAGSD-GKIY 215 (603)
T ss_pred CccceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccc-cceeeEEECCCCCeEEEecCC-ccEE
Confidence 2 23334444433333222 22 22222 244555677787 699999999999999999999 7999
Q ss_pred EEeCCCCCceeee----ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCC----CCeEEEEEcCCCCEE
Q 018806 239 IWDVAQGLGTPIR----RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTS----GFVTGATWDPEGRMI 310 (350)
Q Consensus 239 iwd~~~~~~~~~~----~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~----~~v~~~~~s~~g~~l 310 (350)
+||-.+++..... .|++.|.+++|+||++.+++++.|.+++|||+.+.++.+..... ..--.+.|. ++.+|
T Consensus 216 iyDGktge~vg~l~~~~aHkGsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~~~~~~v~dqqvG~lWq-kd~lI 294 (603)
T KOG0318|consen 216 IYDGKTGEKVGELEDSDAHKGSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTWPMGSTVEDQQVGCLWQ-KDHLI 294 (603)
T ss_pred EEcCCCccEEEEecCCCCccccEEEEEECCCCceEEEecCCceEEEEEeeccceEEEeecCCchhceEEEEEEe-CCeEE
Confidence 9999999876544 47899999999999999999999999999999999885433222 233456676 44444
Q ss_pred EEEECCCeEEEEEEeCCCCCCCceeecccccceeec
Q 018806 311 LLAFAGSLTLGSIHFASKPPSLDAHLLPVDLPDIVS 346 (350)
Q Consensus 311 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~ 346 (350)
.+..++.+......-.+....+.+|..+|+...+..
T Consensus 295 tVSl~G~in~ln~~d~~~~~~i~GHnK~ITaLtv~~ 330 (603)
T KOG0318|consen 295 TVSLSGTINYLNPSDPSVLKVISGHNKSITALTVSP 330 (603)
T ss_pred EEEcCcEEEEecccCCChhheecccccceeEEEEcC
Confidence 444465555555444443447789999998776553
No 36
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.93 E-value=4.4e-24 Score=169.54 Aligned_cols=218 Identities=21% Similarity=0.247 Sum_probs=171.1
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~ 179 (350)
+|..+.|.+|++.|++++.|++++.||.++ ++..... .+|...|+++.-+.-|..++.+++ |+++++||++.+...
T Consensus 92 AVM~l~~~~d~s~i~S~gtDk~v~~wD~~t--G~~~rk~-k~h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~~~ 168 (338)
T KOG0265|consen 92 AVMELHGMRDGSHILSCGTDKTVRGWDAET--GKRIRKH-KGHTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKEAI 168 (338)
T ss_pred eeEeeeeccCCCEEEEecCCceEEEEeccc--ceeeehh-ccccceeeecCccccCCeEEEecCCCceEEEEeecccchh
Confidence 499999999999999999999999999965 6665655 579999999996666777888777 599999999965554
Q ss_pred ceeec------cccc--ccceecCCCCCceEEee--------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC
Q 018806 180 ASVRS------GAAS--FLGALSRGPGTRWTLVD--------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 180 ~~~~~------~~~~--~~~~~~~~~~~~~~~~~--------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~ 243 (350)
+.+.. ..+. ....++.+-++.++.|+ ++.||. ..|+.+..+|+|.++.+-+.|+ ++++||++
T Consensus 169 ~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh~-DtIt~lsls~~gs~llsnsMd~-tvrvwd~r 246 (338)
T KOG0265|consen 169 KTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGHA-DTITGLSLSRYGSFLLSNSMDN-TVRVWDVR 246 (338)
T ss_pred hccccceeEEEEEecccccceeeccccCceeeeccccCcceEEeeccc-CceeeEEeccCCCccccccccc-eEEEEEec
Confidence 44421 1221 22234555554444443 578887 6999999999999999999996 99999998
Q ss_pred CCC----ceeee-ec----CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEE
Q 018806 244 QGL----GTPIR-RG----FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 244 ~~~----~~~~~-~~----~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
... +..+. ++ ......++|+|+++.+.+|+.|+.+++||...... ..+.+|.+.|..++|+|....|.++
T Consensus 247 p~~p~~R~v~if~g~~hnfeknlL~cswsp~~~~i~ags~dr~vyvwd~~~r~~lyklpGh~gsvn~~~Fhp~e~iils~ 326 (338)
T KOG0265|consen 247 PFAPSQRCVKIFQGHIHNFEKNLLKCSWSPNGTKITAGSADRFVYVWDTTSRRILYKLPGHYGSVNEVDFHPTEPIILSC 326 (338)
T ss_pred ccCCCCceEEEeecchhhhhhhcceeeccCCCCccccccccceEEEeecccccEEEEcCCcceeEEEeeecCCCcEEEEe
Confidence 542 23333 22 24567899999999999999999999999988666 5788999999999999999999988
Q ss_pred E-CCCeEEEEE
Q 018806 314 F-AGSLTLGSI 323 (350)
Q Consensus 314 ~-~~~~~~~~~ 323 (350)
+ ++.++++++
T Consensus 327 ~sdk~i~lgei 337 (338)
T KOG0265|consen 327 SSDKTIYLGEI 337 (338)
T ss_pred ccCceeEeecc
Confidence 6 666777665
No 37
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.93 E-value=1.5e-23 Score=178.26 Aligned_cols=216 Identities=22% Similarity=0.340 Sum_probs=165.2
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
.+|++++|+|++++|++++.+|.+++|++.. +...... ..|...+..+.|+|+++.+++++.++.+++|++.....
T Consensus 10 ~~i~~~~~~~~~~~l~~~~~~g~i~i~~~~~--~~~~~~~-~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~~~~- 85 (289)
T cd00200 10 GGVTCVAFSPDGKLLATGSGDGTIKVWDLET--GELLRTL-KGHTGPVRDVAASADGTYLASGSSDKTIRLWDLETGEC- 85 (289)
T ss_pred CCEEEEEEcCCCCEEEEeecCcEEEEEEeeC--CCcEEEE-ecCCcceeEEEECCCCCEEEEEcCCCeEEEEEcCcccc-
Confidence 3499999999999999999999999999964 3333333 46888899999999987888888899999999984322
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~ 258 (350)
...+..|. ..+.++.|+++++.+++++.+ |.|.+||+++++... +..|...+.
T Consensus 86 ------------------------~~~~~~~~-~~i~~~~~~~~~~~~~~~~~~-~~i~~~~~~~~~~~~~~~~~~~~i~ 139 (289)
T cd00200 86 ------------------------VRTLTGHT-SYVSSVAFSPDGRILSSSSRD-KTIKVWDVETGKCLTTLRGHTDWVN 139 (289)
T ss_pred ------------------------eEEEeccC-CcEEEEEEcCCCCEEEEecCC-CeEEEEECCCcEEEEEeccCCCcEE
Confidence 22234443 589999999998888888767 699999999776554 334778899
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceee
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHL 336 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~ 336 (350)
+++|+|+++++++++.|+.|++||+++++. ..+..+...+.+++|+|+++.+++++ ++.+.+|.++.......+..|.
T Consensus 140 ~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~ 219 (289)
T cd00200 140 SVAFSPDGTFVASSSQDGTIKLWDLRTGKCVATLTGHTGEVNSVAFSPDGEKLLSSSSDGTIKLWDLSTGKCLGTLRGHE 219 (289)
T ss_pred EEEEcCcCCEEEEEcCCCcEEEEEccccccceeEecCccccceEEECCCcCEEEEecCCCcEEEEECCCCceecchhhcC
Confidence 999999999999888899999999997776 44557777999999999998888887 4444444433322233444566
Q ss_pred cccccceee
Q 018806 337 LPVDLPDIV 345 (350)
Q Consensus 337 ~~v~~~~~~ 345 (350)
.++....+.
T Consensus 220 ~~i~~~~~~ 228 (289)
T cd00200 220 NGVNSVAFS 228 (289)
T ss_pred CceEEEEEc
Confidence 555544443
No 38
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.93 E-value=2.2e-24 Score=189.90 Aligned_cols=190 Identities=14% Similarity=0.167 Sum_probs=161.5
Q ss_pred CccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCC-ceeE-----ecCCCCCCeeEEEEeeCCCeEEEEecCCcEEE
Q 018806 98 PEVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGK-DACI-----LTSDSQRDVKVLEWRPNGGRSLSVGCKGGICI 170 (350)
Q Consensus 98 ~~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~-~~~~-----~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~i 170 (350)
+...|.+++++..+ .+++++|.|+++++|++...... .... ....|+..|++++.+|+.+.+++++.|++.+|
T Consensus 410 H~~svgava~~~~~asffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKi 489 (775)
T KOG0319|consen 410 HTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGSQDKTAKI 489 (775)
T ss_pred cccccceeeecccCccEEEEecCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecccccceee
Confidence 34579999998766 79999999999999999641111 1111 12369999999999999777777888999999
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI 250 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~ 250 (350)
|+++ ...+..++.||. ..|+++.|+|..+.+++++.| ++|+||.+.+..+...
T Consensus 490 W~le-------------------------~~~l~~vLsGH~-RGvw~V~Fs~~dq~laT~SgD-~TvKIW~is~fSClkT 542 (775)
T KOG0319|consen 490 WDLE-------------------------QLRLLGVLSGHT-RGVWCVSFSKNDQLLATCSGD-KTVKIWSISTFSCLKT 542 (775)
T ss_pred eccc-------------------------CceEEEEeeCCc-cceEEEEeccccceeEeccCC-ceEEEEEeccceeeee
Confidence 9998 223466789997 799999999999999999999 5999999999998775
Q ss_pred e-ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 251 R-RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 251 ~-~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+ +|...|..+.|-.+|++|++++.||-|++|+++++++ ..+-.|...|++++-++.+.++++|+
T Consensus 543 ~eGH~~aVlra~F~~~~~qliS~~adGliKlWnikt~eC~~tlD~H~DrvWaL~~~~~~~~~~tgg 608 (775)
T KOG0319|consen 543 FEGHTSAVLRASFIRNGKQLISAGADGLIKLWNIKTNECEMTLDAHNDRVWALSVSPLLDMFVTGG 608 (775)
T ss_pred ecCccceeEeeeeeeCCcEEEeccCCCcEEEEeccchhhhhhhhhccceeEEEeecCccceeEecC
Confidence 5 5889999999999999999999999999999999998 56779999999999999999888774
No 39
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=2.2e-24 Score=178.10 Aligned_cols=245 Identities=13% Similarity=0.158 Sum_probs=180.8
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCcc---------------------------CeeEEEEecCCCEEEEEECCCeEEEE
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEV---------------------------DLQGVSWHQHKHIVAFISGSTQVIVR 126 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~---------------------------~V~~v~~sp~g~~la~~s~d~~i~iw 126 (350)
..+++.|..++....+.+.+..+..+. +|.-+.||||.++|++++.|..+.+|
T Consensus 217 ~qil~~htdEVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~lw 296 (519)
T KOG0293|consen 217 WQILQDHTDEVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSLW 296 (519)
T ss_pred hhhHhhCCCcEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeeecccCceEEEEECCCCCeEEecCchHheeec
Confidence 467778888887777776655554432 68999999999999999999999999
Q ss_pred EccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeee
Q 018806 127 DYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDF 206 (350)
Q Consensus 127 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 206 (350)
|+.+ +.....+..++...+.+++|.|||.++++++.|+++..||++ +.............+..++..+|+++.+.-.
T Consensus 297 Dv~t--gd~~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlD-gn~~~~W~gvr~~~v~dlait~Dgk~vl~v~ 373 (519)
T KOG0293|consen 297 DVDT--GDLRHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLD-GNILGNWEGVRDPKVHDLAITYDGKYVLLVT 373 (519)
T ss_pred cCCc--chhhhhcccCcCCCcceeEEccCCceeEecCCCCcEEEecCC-cchhhcccccccceeEEEEEcCCCcEEEEEe
Confidence 9965 666666655677899999999999999999999999999998 3322222222223344466666666543211
Q ss_pred -----------------ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce-eeeecCC--CeEEEEEcC-C
Q 018806 207 -----------------LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT-PIRRGFG--GLSILKWSP-T 265 (350)
Q Consensus 207 -----------------~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~--~v~~~~~sp-~ 265 (350)
+... ..+|+++..|.|++++++.-.+. .+.+||++..... ...+|.. .+..-||-- +
T Consensus 374 ~d~~i~l~~~e~~~dr~lise-~~~its~~iS~d~k~~LvnL~~q-ei~LWDl~e~~lv~kY~Ghkq~~fiIrSCFgg~~ 451 (519)
T KOG0293|consen 374 VDKKIRLYNREARVDRGLISE-EQPITSFSISKDGKLALVNLQDQ-EIHLWDLEENKLVRKYFGHKQGHFIIRSCFGGGN 451 (519)
T ss_pred cccceeeechhhhhhhccccc-cCceeEEEEcCCCcEEEEEcccC-eeEEeecchhhHHHHhhcccccceEEEeccCCCC
Confidence 1111 25899999999999999888884 9999999966544 3555653 355566754 5
Q ss_pred CCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEE
Q 018806 266 GDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSI 323 (350)
Q Consensus 266 g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~ 323 (350)
..++++|++|+.|+||+..+++. ..+.+|...|.+++|+|....++++.+++.++..|
T Consensus 452 ~~fiaSGSED~kvyIWhr~sgkll~~LsGHs~~vNcVswNP~~p~m~ASasDDgtIRIW 510 (519)
T KOG0293|consen 452 DKFIASGSEDSKVYIWHRISGKLLAVLSGHSKTVNCVSWNPADPEMFASASDDGTIRIW 510 (519)
T ss_pred cceEEecCCCceEEEEEccCCceeEeecCCcceeeEEecCCCCHHHhhccCCCCeEEEe
Confidence 68999999999999999999998 56889999999999999776655444333344444
No 40
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.93 E-value=7.9e-24 Score=173.05 Aligned_cols=241 Identities=15% Similarity=0.231 Sum_probs=178.9
Q ss_pred CcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCe---EEEEecCCcEE
Q 018806 93 HVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGR---SLSVGCKGGIC 169 (350)
Q Consensus 93 ~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~---l~~~~~d~~v~ 169 (350)
...+++...|.++... +++|++|++||.+++|+.. |+....+ .+|.++|.+++|...+.. +++++.|.+++
T Consensus 99 l~~~~hdDWVSsv~~~--~~~IltgsYDg~~riWd~~---Gk~~~~~-~Ght~~ik~v~~v~~n~~~~~fvsas~Dqtl~ 172 (423)
T KOG0313|consen 99 LQCFLHDDWVSSVKGA--SKWILTGSYDGTSRIWDLK---GKSIKTI-VGHTGPIKSVAWVIKNSSSCLFVSASMDQTLR 172 (423)
T ss_pred cccccchhhhhhhccc--CceEEEeecCCeeEEEecC---CceEEEE-ecCCcceeeeEEEecCCccceEEEecCCceEE
Confidence 4567777888888887 7899999999999999975 6666655 489999998888544344 88888899999
Q ss_pred EEecCCCCCCcee---eccccccccee----------cCCCCCceE---------------------------------E
Q 018806 170 IWAPSYPGNAASV---RSGAASFLGAL----------SRGPGTRWT---------------------------------L 203 (350)
Q Consensus 170 iwd~~~~~~~~~~---~~~~~~~~~~~----------~~~~~~~~~---------------------------------~ 203 (350)
+|.++.+...... ..++...+..+ +.+.|..+. .
T Consensus 173 Lw~~~~~~~~~~~~~~~~GHk~~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P 252 (423)
T KOG0313|consen 173 LWKWNVGENKVKALKVCRGHKRSVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTP 252 (423)
T ss_pred EEEecCchhhhhHHhHhcccccceeEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCc
Confidence 9988744322111 11222222222 222222222 2
Q ss_pred eeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 204 VDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 204 ~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
.-++.||. ..|.++.|++ ...+++++.|. +|+.||+.++...........+.++..+|..++|++|+.|..+++||.
T Consensus 253 ~vtl~GHt-~~Vs~V~w~d-~~v~yS~SwDH-TIk~WDletg~~~~~~~~~ksl~~i~~~~~~~Ll~~gssdr~irl~DP 329 (423)
T KOG0313|consen 253 LVTLEGHT-EPVSSVVWSD-ATVIYSVSWDH-TIKVWDLETGGLKSTLTTNKSLNCISYSPLSKLLASGSSDRHIRLWDP 329 (423)
T ss_pred eEEecccc-cceeeEEEcC-CCceEeecccc-eEEEEEeecccceeeeecCcceeEeecccccceeeecCCCCceeecCC
Confidence 23577887 7999999998 67899999996 999999999998887778889999999999999999999999999999
Q ss_pred CCCce----eccccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCCCCC-CCceeecccccc
Q 018806 284 NTWTS----EPWSSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHFASKPP-SLDAHLLPVDLP 342 (350)
Q Consensus 284 ~~~~~----~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~~~~-~~~~~~~~v~~~ 342 (350)
+++.- .++.+|.+.|.++.|+|...++++++ |+...+|+++-...+. .+.+|...|-..
T Consensus 330 R~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~~S~S~D~t~klWDvRS~k~plydI~~h~DKvl~v 395 (423)
T KOG0313|consen 330 RTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQLVSGSYDNTVKLWDVRSTKAPLYDIAGHNDKVLSV 395 (423)
T ss_pred CCCCCceeEEeeecchhhhhheecCCCCceEEEEEecCCeEEEEEeccCCCcceeeccCCceEEEE
Confidence 98753 46789999999999999888776665 5555555555444332 667777666443
No 41
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.93 E-value=2e-24 Score=197.90 Aligned_cols=236 Identities=20% Similarity=0.351 Sum_probs=180.1
Q ss_pred cCeeEEEEecCCCEEEEEE--CCCeEEEEEccCCC----------CCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCc
Q 018806 100 VDLQGVSWHQHKHIVAFIS--GSTQVIVRDYEDSE----------GKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGG 167 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s--~d~~i~iw~~~~~~----------~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~ 167 (350)
..|.++..+|||..+|+|+ .|+.+.||+.+.-- .+.++.. ..|.+.|+|+.|+|||++|++++.|+.
T Consensus 14 ~~IfSIdv~pdg~~~aTgGq~~d~~~~iW~~~~vl~~~~~~~~~l~k~l~~m-~~h~~sv~CVR~S~dG~~lAsGSDD~~ 92 (942)
T KOG0973|consen 14 KSIFSIDVHPDGVKFATGGQVLDGGIVIWSQDPVLDEKEEKNENLPKHLCTM-DDHDGSVNCVRFSPDGSYLASGSDDRL 92 (942)
T ss_pred eeEEEEEecCCceeEecCCccccccceeeccccccchhhhhhcccchhheee-ccccCceeEEEECCCCCeEeeccCcce
Confidence 3589999999999999999 89999999864210 1122223 469999999999999999988888999
Q ss_pred EEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc
Q 018806 168 ICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG 247 (350)
Q Consensus 168 v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~ 247 (350)
|.||.... .....+... . =-......|++...+.+|. ..|.+++|+|++.+|++++.|+ +|.+||..+.+.
T Consensus 93 v~iW~~~~-~~~~~~fgs----~--g~~~~vE~wk~~~~l~~H~-~DV~Dv~Wsp~~~~lvS~s~Dn-sViiwn~~tF~~ 163 (942)
T KOG0973|consen 93 VMIWERAE-IGSGTVFGS----T--GGAKNVESWKVVSILRGHD-SDVLDVNWSPDDSLLVSVSLDN-SVIIWNAKTFEL 163 (942)
T ss_pred EEEeeecc-cCCcccccc----c--ccccccceeeEEEEEecCC-CccceeccCCCccEEEEecccc-eEEEEcccccee
Confidence 99999873 111110000 0 0011124689999999996 7999999999999999999995 999999999866
Q ss_pred ee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cc------cCCCCeEEEEEcCCCCEEEEEE--C-C
Q 018806 248 TP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WS------STSGFVTGATWDPEGRMILLAF--A-G 316 (350)
Q Consensus 248 ~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~------~~~~~v~~~~~s~~g~~l~~~~--~-~ 316 (350)
.. +..|.+.|-.+.|.|-|++||+-+.|++|+||++.+..... +. .....+..+.|||||++|++.. . +
T Consensus 164 ~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~~~~~T~f~RlSWSPDG~~las~nA~n~~ 243 (942)
T KOG0973|consen 164 LKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEESPLTTFFLRLSWSPDGHHLASPNAVNGG 243 (942)
T ss_pred eeeeecccccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhhCCCcceeeecccCCCcCeecchhhccCC
Confidence 54 56788999999999999999999999999999977655422 21 2345678999999999999875 2 2
Q ss_pred CeEEEEE--EeCCCCCCCceeecccccceee
Q 018806 317 SLTLGSI--HFASKPPSLDAHLLPVDLPDIV 345 (350)
Q Consensus 317 ~~~~~~~--~~~~~~~~~~~~~~~v~~~~~~ 345 (350)
...+-.+ ..|.....+-+|..|++...++
T Consensus 244 ~~~~~IieR~tWk~~~~LvGH~~p~evvrFn 274 (942)
T KOG0973|consen 244 KSTIAIIERGTWKVDKDLVGHSAPVEVVRFN 274 (942)
T ss_pred cceeEEEecCCceeeeeeecCCCceEEEEeC
Confidence 2333333 4455566888999999877665
No 42
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.93 E-value=2.9e-24 Score=177.40 Aligned_cols=212 Identities=14% Similarity=0.174 Sum_probs=168.4
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+|+-+.||++|++||+++.|.+..||.+.....-.+.....+|..+|..+.||||.+++++++.+..+.+||+.++..
T Consensus 224 tdEVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~lwDv~tgd~ 303 (519)
T KOG0293|consen 224 TDEVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSLWDVDTGDL 303 (519)
T ss_pred CCcEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeeecccCceEEEEECCCCCeEEecCchHheeeccCCcchh
Confidence 45899999999999999999999999999864433233333458999999999999999999999999999999996554
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec-CCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG-FGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~~~v 257 (350)
...... + ....+.+.+|.|||..+++|+.| +++..||++......-.+- ...|
T Consensus 304 ~~~y~~------------------------~-~~~S~~sc~W~pDg~~~V~Gs~d-r~i~~wdlDgn~~~~W~gvr~~~v 357 (519)
T KOG0293|consen 304 RHLYPS------------------------G-LGFSVSSCAWCPDGFRFVTGSPD-RTIIMWDLDGNILGNWEGVRDPKV 357 (519)
T ss_pred hhhccc------------------------C-cCCCcceeEEccCCceeEecCCC-CcEEEecCCcchhhccccccccee
Confidence 332221 1 23688999999999999999999 5999999987654333332 3568
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceee
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHL 336 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~ 336 (350)
.+++.++||+++++...|..|++|+.++...+.+.....+|+++..|.||+++++.- +..+.+|++.-+.....+.+|.
T Consensus 358 ~dlait~Dgk~vl~v~~d~~i~l~~~e~~~dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~kY~Ghk 437 (519)
T KOG0293|consen 358 HDLAITYDGKYVLLVTVDKKIRLYNREARVDRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRKYFGHK 437 (519)
T ss_pred EEEEEcCCCcEEEEEecccceeeechhhhhhhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHHhhccc
Confidence 999999999999999999999999999877776777788999999999999998875 5555665555332233555553
No 43
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.92 E-value=4.3e-24 Score=165.90 Aligned_cols=218 Identities=19% Similarity=0.271 Sum_probs=163.4
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCe-EEEEecCCcEEEEecCCC
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGR-SLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~~~~d~~v~iwd~~~~ 176 (350)
...+..++|+++- +.+++++.||+++|||... ...+....+.|...|.++.|++..++ +++++-|++|++|+...+
T Consensus 60 ~D~LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~--~s~Pi~~~kEH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~ 137 (311)
T KOG0277|consen 60 EDGLFDVAWSENHENQVIAASGDGSLRLFDLTM--PSKPIHKFKEHKREVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRP 137 (311)
T ss_pred ccceeEeeecCCCcceEEEEecCceEEEeccCC--CCcchhHHHhhhhheEEeccccccceeEEeeccCCceEeecCCCC
Confidence 4568999999965 6788899999999999743 33334444689999999999986544 555556999999998844
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCC-CceeeeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQG-LGTPIRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~-~~~~~~~~~ 254 (350)
.. +.++.+|. ..|...+|+|. ...+++++.| |++++||++.. +...+..|.
T Consensus 138 ~S-------------------------v~Tf~gh~-~~Iy~a~~sp~~~nlfas~Sgd-~~l~lwdvr~~gk~~~i~ah~ 190 (311)
T KOG0277|consen 138 NS-------------------------VQTFNGHN-SCIYQAAFSPHIPNLFASASGD-GTLRLWDVRSPGKFMSIEAHN 190 (311)
T ss_pred cc-------------------------eEeecCCc-cEEEEEecCCCCCCeEEEccCC-ceEEEEEecCCCceeEEEecc
Confidence 33 45578886 79999999995 6788889999 79999999864 444566688
Q ss_pred CCeEEEEEcC-CCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC-
Q 018806 255 GGLSILKWSP-TGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP- 330 (350)
Q Consensus 255 ~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~- 330 (350)
..+.++.|+. +...|++|+.|+.|++||+++-+. ..+.+|+-.|..+.|||...-|+++++-+.++..|+......
T Consensus 191 ~Eil~cdw~ky~~~vl~Tg~vd~~vr~wDir~~r~pl~eL~gh~~AVRkvk~Sph~~~lLaSasYDmT~riw~~~~~ds~ 270 (311)
T KOG0277|consen 191 SEILCCDWSKYNHNVLATGGVDNLVRGWDIRNLRTPLFELNGHGLAVRKVKFSPHHASLLASASYDMTVRIWDPERQDSA 270 (311)
T ss_pred ceeEeecccccCCcEEEecCCCceEEEEehhhccccceeecCCceEEEEEecCcchhhHhhhccccceEEecccccchhh
Confidence 8999999998 556789999999999999998775 456789999999999998877666654444444444432221
Q ss_pred --CCceeecccccceee
Q 018806 331 --SLDAHLLPVDLPDIV 345 (350)
Q Consensus 331 --~~~~~~~~v~~~~~~ 345 (350)
+...|.--+.+..++
T Consensus 271 ~e~~~~HtEFv~g~Dws 287 (311)
T KOG0277|consen 271 IETVDHHTEFVCGLDWS 287 (311)
T ss_pred hhhhhccceEEeccccc
Confidence 444555444444433
No 44
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.92 E-value=6e-24 Score=183.98 Aligned_cols=187 Identities=16% Similarity=0.275 Sum_probs=165.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+|++..|-+..+++++|+.|..|+||+.++ +..+..+ ..|..-|.+++.+|.-..+++++.|-+|++||.+
T Consensus 55 ~~PvRa~kfiaRknWiv~GsDD~~IrVfnynt--~ekV~~F-eAH~DyIR~iavHPt~P~vLtsSDDm~iKlW~we---- 127 (794)
T KOG0276|consen 55 EVPVRAAKFIARKNWIVTGSDDMQIRVFNYNT--GEKVKTF-EAHSDYIRSIAVHPTLPYVLTSSDDMTIKLWDWE---- 127 (794)
T ss_pred ccchhhheeeeccceEEEecCCceEEEEeccc--ceeeEEe-eccccceeeeeecCCCCeEEecCCccEEEEeecc----
Confidence 34788999999999999999999999999954 6666666 5899999999999998888888889999999997
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGG 256 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~ 256 (350)
..|.+.+++.||. .-|++++|+| |...+++++.| ++|++|.+.+..+.. +.+|..+
T Consensus 128 --------------------~~wa~~qtfeGH~-HyVMqv~fnPkD~ntFaS~sLD-rTVKVWslgs~~~nfTl~gHekG 185 (794)
T KOG0276|consen 128 --------------------NEWACEQTFEGHE-HYVMQVAFNPKDPNTFASASLD-RTVKVWSLGSPHPNFTLEGHEKG 185 (794)
T ss_pred --------------------CceeeeeEEcCcc-eEEEEEEecCCCccceeeeecc-ccEEEEEcCCCCCceeeeccccC
Confidence 2688899999997 6999999999 57789999999 599999999887654 6678999
Q ss_pred eEEEEEcCC--CCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 257 LSILKWSPT--GDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 257 v~~~~~sp~--g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
|.++++-+- ..+|++|++|.+|+|||.++.++ .++.+|...|..+.|+|.=..+++|+
T Consensus 186 VN~Vdyy~~gdkpylIsgaDD~tiKvWDyQtk~CV~TLeGHt~Nvs~v~fhp~lpiiisgs 246 (794)
T KOG0276|consen 186 VNCVDYYTGGDKPYLISGADDLTIKVWDYQTKSCVQTLEGHTNNVSFVFFHPELPIIISGS 246 (794)
T ss_pred cceEEeccCCCcceEEecCCCceEEEeecchHHHHHHhhcccccceEEEecCCCcEEEEec
Confidence 999999874 46999999999999999999998 56779999999999999999999886
No 45
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=6.9e-24 Score=163.04 Aligned_cols=182 Identities=16% Similarity=0.210 Sum_probs=155.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
.+|.++.|+-||++.++++.|+++++|+.- .+..+..+ .+|...|..++.+.|+..++++|.|+.+.+||+.+++.
T Consensus 18 gaV~avryN~dGnY~ltcGsdrtvrLWNp~--rg~liktY-sghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv- 93 (307)
T KOG0316|consen 18 GAVRAVRYNVDGNYCLTCGSDRTVRLWNPL--RGALIKTY-SGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKV- 93 (307)
T ss_pred cceEEEEEccCCCEEEEcCCCceEEeeccc--ccceeeee-cCCCceeeeccccccccccccCCCCceEEEEEcccCee-
Confidence 469999999999999999999999999984 47776666 58999999999999999999999999999999995543
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee---ecCCC
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR---RGFGG 256 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~---~~~~~ 256 (350)
.+.+.+|. +.|..++|+.+...+++++.|. ++++||.++....+++ .....
T Consensus 94 ------------------------~Rr~rgH~-aqVNtV~fNeesSVv~SgsfD~-s~r~wDCRS~s~ePiQildea~D~ 147 (307)
T KOG0316|consen 94 ------------------------DRRFRGHL-AQVNTVRFNEESSVVASGSFDS-SVRLWDCRSRSFEPIQILDEAKDG 147 (307)
T ss_pred ------------------------eeeccccc-ceeeEEEecCcceEEEeccccc-eeEEEEcccCCCCccchhhhhcCc
Confidence 55578886 8999999999999999999996 9999999987665544 34578
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
|.++..+ +..|++|+.||+++.||++.|+... .....+|+++.|++||+.+++++
T Consensus 148 V~Si~v~--~heIvaGS~DGtvRtydiR~G~l~s-Dy~g~pit~vs~s~d~nc~La~~ 202 (307)
T KOG0316|consen 148 VSSIDVA--EHEIVAGSVDGTVRTYDIRKGTLSS-DYFGHPITSVSFSKDGNCSLASS 202 (307)
T ss_pred eeEEEec--ccEEEeeccCCcEEEEEeecceeeh-hhcCCcceeEEecCCCCEEEEee
Confidence 8888774 5679999999999999999987732 23456899999999999999886
No 46
>PTZ00420 coronin; Provisional
Probab=99.92 E-value=6.7e-23 Score=185.39 Aligned_cols=198 Identities=15% Similarity=0.235 Sum_probs=139.3
Q ss_pred ccCeeEEEEecC-CCEEEEEECCCeEEEEEccCCCCC-----ceeEecCCCCCCeeEEEEeeCCCeEE-EEecCCcEEEE
Q 018806 99 EVDLQGVSWHQH-KHIVAFISGSTQVIVRDYEDSEGK-----DACILTSDSQRDVKVLEWRPNGGRSL-SVGCKGGICIW 171 (350)
Q Consensus 99 ~~~V~~v~~sp~-g~~la~~s~d~~i~iw~~~~~~~~-----~~~~~~~~~~~~v~~~~~sp~~~~l~-~~~~d~~v~iw 171 (350)
...|.+++|+|+ +++||+|+.|++|+||++...... .......+|...|.+++|+|++..++ +++.|++|+||
T Consensus 74 ~~~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIW 153 (568)
T PTZ00420 74 TSSILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIW 153 (568)
T ss_pred CCCEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEE
Confidence 456999999997 799999999999999999642110 11122357999999999999987765 56679999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-e
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-I 250 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~ 250 (350)
|+....... .+. +. ..|.+++|+|+|+.|++++.| +.|++||+++++... +
T Consensus 154 Dl~tg~~~~-------------------------~i~-~~-~~V~SlswspdG~lLat~s~D-~~IrIwD~Rsg~~i~tl 205 (568)
T PTZ00420 154 DIENEKRAF-------------------------QIN-MP-KKLSSLKWNIKGNLLSGTCVG-KHMHIIDPRKQEIASSF 205 (568)
T ss_pred ECCCCcEEE-------------------------EEe-cC-CcEEEEEECCCCCEEEEEecC-CEEEEEECCCCcEEEEE
Confidence 998443211 122 22 579999999999999999988 699999999987654 4
Q ss_pred eecCCCeE-----EEEEcCCCCEEEEEecCC----eEEEEeCCC-CceeccccC---CCCeEEEEEcCCCCEEEEEE-CC
Q 018806 251 RRGFGGLS-----ILKWSPTGDYFFAAKFDG----TFYLWETNT-WTSEPWSST---SGFVTGATWDPEGRMILLAF-AG 316 (350)
Q Consensus 251 ~~~~~~v~-----~~~~sp~g~~l~~~~~d~----~v~iwd~~~-~~~~~~~~~---~~~v~~~~~s~~g~~l~~~~-~~ 316 (350)
..|.+.+. ...|++++.+|++++.|+ .|+|||++. .+......+ .+.+...-..++|.++++|. ++
T Consensus 206 ~gH~g~~~s~~v~~~~fs~d~~~IlTtG~d~~~~R~VkLWDlr~~~~pl~~~~ld~~~~~L~p~~D~~tg~l~lsGkGD~ 285 (568)
T PTZ00420 206 HIHDGGKNTKNIWIDGLGGDDNYILSTGFSKNNMREMKLWDLKNTTSALVTMSIDNASAPLIPHYDESTGLIYLIGKGDG 285 (568)
T ss_pred ecccCCceeEEEEeeeEcCCCCEEEEEEcCCCCccEEEEEECCCCCCceEEEEecCCccceEEeeeCCCCCEEEEEECCC
Confidence 45655433 234568999998887664 799999995 343333222 23333333344577777664 44
Q ss_pred CeEEEEEE
Q 018806 317 SLTLGSIH 324 (350)
Q Consensus 317 ~~~~~~~~ 324 (350)
.+++|++.
T Consensus 286 tIr~~e~~ 293 (568)
T PTZ00420 286 NCRYYQHS 293 (568)
T ss_pred eEEEEEcc
Confidence 45555553
No 47
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.92 E-value=7e-23 Score=197.79 Aligned_cols=199 Identities=14% Similarity=0.253 Sum_probs=154.4
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCC--CCCc--eeEecCCCCCCeeEEEEeeC-CCeEEEEecCCcEEEEe
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS--EGKD--ACILTSDSQRDVKVLEWRPN-GGRSLSVGCKGGICIWA 172 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~--~~~~--~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd 172 (350)
+...|.+++|+|+|++||+|+.|+.|+||+.... .+.. .......+...+.+++|+|. +..+++++.|++|++||
T Consensus 482 ~~~~V~~i~fs~dg~~latgg~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~Dg~v~lWd 561 (793)
T PLN00181 482 SSNLVCAIGFDRDGEFFATAGVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNFEGVVQVWD 561 (793)
T ss_pred CCCcEEEEEECCCCCEEEEEeCCCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEeCCCeEEEEE
Confidence 5668999999999999999999999999997531 1110 00111134567999999875 56777777799999999
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCceeee
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGTPIR 251 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~~~~ 251 (350)
+.... ....+.+|. ..|++++|+| ++.+|++++.| |+|++||++++......
T Consensus 562 ~~~~~-------------------------~~~~~~~H~-~~V~~l~~~p~~~~~L~Sgs~D-g~v~iWd~~~~~~~~~~ 614 (793)
T PLN00181 562 VARSQ-------------------------LVTEMKEHE-KRVWSIDYSSADPTLLASGSDD-GSVKLWSINQGVSIGTI 614 (793)
T ss_pred CCCCe-------------------------EEEEecCCC-CCEEEEEEcCCCCCEEEEEcCC-CEEEEEECCCCcEEEEE
Confidence 97332 234466775 7999999997 78899999999 79999999988776655
Q ss_pred ecCCCeEEEEEc-CCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 252 RGFGGLSILKWS-PTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 252 ~~~~~v~~~~~s-p~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
.+...+.++.|+ ++|.+|++|+.|+.|++||+++.+. ..+.+|...|..+.|. ++.+|++++ ++.+.+|+++
T Consensus 615 ~~~~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~s~D~~ikiWd~~ 690 (793)
T PLN00181 615 KTKANICCVQFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFV-DSSTLVSSSTDNTLKLWDLS 690 (793)
T ss_pred ecCCCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecCCCCCEEEEEEe-CCCEEEEEECCCEEEEEeCC
Confidence 566789999995 5799999999999999999987653 4566899999999997 678888776 4445555543
No 48
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=7.2e-24 Score=189.53 Aligned_cols=197 Identities=15% Similarity=0.243 Sum_probs=155.5
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccC----------------------------CCC-----C---------
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYED----------------------------SEG-----K--------- 134 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~----------------------------~~~-----~--------- 134 (350)
.+...|+++.||+||+|||+|+.|+.|+||.+-. ... .
T Consensus 265 ah~gaIw~mKFS~DGKyLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~~~s~~~~~~~ 344 (712)
T KOG0283|consen 265 AHKGAIWAMKFSHDGKYLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISSRTSSSRKGSQ 344 (712)
T ss_pred ccCCcEEEEEeCCCCceeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCccccccccccccccccccccC
Confidence 3455899999999999999999999999998743 000 0
Q ss_pred ---------------ceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCC
Q 018806 135 ---------------DACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGT 199 (350)
Q Consensus 135 ---------------~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~ 199 (350)
.+...+.+|.+.|.++.||-+ +.|++++.|++|++|++....+...
T Consensus 345 s~~~~~p~~~f~f~ekP~~ef~GHt~DILDlSWSKn-~fLLSSSMDKTVRLWh~~~~~CL~~------------------ 405 (712)
T KOG0283|consen 345 SPCVLLPLKAFVFSEKPFCEFKGHTADILDLSWSKN-NFLLSSSMDKTVRLWHPGRKECLKV------------------ 405 (712)
T ss_pred CccccCCCccccccccchhhhhccchhheecccccC-CeeEeccccccEEeecCCCcceeeE------------------
Confidence 000122478999999999988 8999999999999999985544332
Q ss_pred ceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeE
Q 018806 200 RWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTF 278 (350)
Q Consensus 200 ~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v 278 (350)
+ .|. .-|+|++|+| |.+++++|+.| |.|+||++...+......-..-|++++|.|||+..+.|+.+|.+
T Consensus 406 -------F-~Hn-dfVTcVaFnPvDDryFiSGSLD-~KvRiWsI~d~~Vv~W~Dl~~lITAvcy~PdGk~avIGt~~G~C 475 (712)
T KOG0283|consen 406 -------F-SHN-DFVTCVAFNPVDDRYFISGSLD-GKVRLWSISDKKVVDWNDLRDLITAVCYSPDGKGAVIGTFNGYC 475 (712)
T ss_pred -------E-ecC-CeeEEEEecccCCCcEeecccc-cceEEeecCcCeeEeehhhhhhheeEEeccCCceEEEEEeccEE
Confidence 2 233 6999999999 78999999999 79999999988776666666889999999999999999999999
Q ss_pred EEEeCCCCceec---cc-------cCCCCeEEEEEcCCCC--EEEEEECCCeEEEEE
Q 018806 279 YLWETNTWTSEP---WS-------STSGFVTGATWDPEGR--MILLAFAGSLTLGSI 323 (350)
Q Consensus 279 ~iwd~~~~~~~~---~~-------~~~~~v~~~~~s~~g~--~l~~~~~~~~~~~~~ 323 (350)
++|+....+... +. .+. .|+.+.|.|... .|+++.|..++|++.
T Consensus 476 ~fY~t~~lk~~~~~~I~~~~~Kk~~~~-rITG~Q~~p~~~~~vLVTSnDSrIRI~d~ 531 (712)
T KOG0283|consen 476 RFYDTEGLKLVSDFHIRLHNKKKKQGK-RITGLQFFPGDPDEVLVTSNDSRIRIYDG 531 (712)
T ss_pred EEEEccCCeEEEeeeEeeccCccccCc-eeeeeEecCCCCCeEEEecCCCceEEEec
Confidence 999998877632 11 233 799999987544 566555766666666
No 49
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.92 E-value=2.3e-23 Score=186.95 Aligned_cols=248 Identities=12% Similarity=0.148 Sum_probs=196.0
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCcc------------------------CeeEEEEecCCCEEEEEECCCeEEEEEc
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEV------------------------DLQGVSWHQHKHIVAFISGSTQVIVRDY 128 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~------------------------~V~~v~~sp~g~~la~~s~d~~i~iw~~ 128 (350)
|+.-+..|.+.+....++|.++.++.+. -|+.+.|++.-.+|+++|.|.+|+||++
T Consensus 43 li~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL~GHlDYVRt~~FHheyPWIlSASDDQTIrIWNw 122 (1202)
T KOG0292|consen 43 LIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTLLGHLDYVRTVFFHHEYPWILSASDDQTIRIWNW 122 (1202)
T ss_pred HHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhhccccceeEEeeccCCCceEEEccCCCeEEEEec
Confidence 4566778999998899999988877754 4899999999999999999999999999
Q ss_pred cCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccce---ec--CCCCCceEE
Q 018806 129 EDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGA---LS--RGPGTRWTL 203 (350)
Q Consensus 129 ~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~---~~--~~~~~~~~~ 203 (350)
. +.+++..++ +|...|.|.+|+|....+++++-|.+|+|||+. +-.......+....... .. .-+.....+
T Consensus 123 q--sr~~iavlt-GHnHYVMcAqFhptEDlIVSaSLDQTVRVWDis-GLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVV 198 (1202)
T KOG0292|consen 123 Q--SRKCIAVLT-GHNHYVMCAQFHPTEDLIVSASLDQTVRVWDIS-GLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVV 198 (1202)
T ss_pred c--CCceEEEEe-cCceEEEeeccCCccceEEEecccceEEEEeec-chhccCCCCCCchhhhhccccchhhcCCcCeee
Confidence 5 477777774 999999999999986778888889999999997 22222222221100000 00 001112345
Q ss_pred eeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC---ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEE
Q 018806 204 VDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL---GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYL 280 (350)
Q Consensus 204 ~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~---~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~i 280 (350)
...+.||. ..|.-++|+|.-..|++|+.|. .|++|.+...+ .....+|...|.++-|+|...+|++.++|++|+|
T Consensus 199 K~VLEGHD-RGVNwaAfhpTlpliVSG~DDR-qVKlWrmnetKaWEvDtcrgH~nnVssvlfhp~q~lIlSnsEDksirV 276 (1202)
T KOG0292|consen 199 KHVLEGHD-RGVNWAAFHPTLPLIVSGADDR-QVKLWRMNETKAWEVDTCRGHYNNVSSVLFHPHQDLILSNSEDKSIRV 276 (1202)
T ss_pred eeeecccc-cccceEEecCCcceEEecCCcc-eeeEEEeccccceeehhhhcccCCcceEEecCccceeEecCCCccEEE
Confidence 66788996 7999999999999999999995 99999987654 3356789999999999999999999999999999
Q ss_pred EeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 281 WETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 281 wd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
||+...+.. ++....+..+.++-+|..+++++|.|+...++.+...
T Consensus 277 wDm~kRt~v~tfrrendRFW~laahP~lNLfAAgHDsGm~VFkleRE 323 (1202)
T KOG0292|consen 277 WDMTKRTSVQTFRRENDRFWILAAHPELNLFAAGHDSGMIVFKLERE 323 (1202)
T ss_pred EecccccceeeeeccCCeEEEEEecCCcceeeeecCCceEEEEEccc
Confidence 999988774 4556677899999999999999998888777777643
No 50
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.92 E-value=3.8e-23 Score=171.79 Aligned_cols=216 Identities=17% Similarity=0.203 Sum_probs=171.5
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..|+.+.++|+...+++++.|..|+||.... ...... ...|..+|+.+..+|.|.++++++.|++..+.|++.+...
T Consensus 262 kki~~v~~~~~~~~v~~aSad~~i~vws~~~--~s~~~~-~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~l 338 (506)
T KOG0289|consen 262 KKITSVKFHKDLDTVITASADEIIRVWSVPL--SSEPTS-SRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQL 338 (506)
T ss_pred eEEEEEEeccchhheeecCCcceEEeecccc--ccCccc-cccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEE
Confidence 3699999999999999999999999999864 333333 3579999999999999999999999999999999854433
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~ 258 (350)
..+.. . ..+-.+++.+|+|||-.|.++..| |.+++||+.++.... +-+|.++|.
T Consensus 339 t~vs~-----------------------~-~s~v~~ts~~fHpDgLifgtgt~d-~~vkiwdlks~~~~a~Fpght~~vk 393 (506)
T KOG0289|consen 339 TVVSD-----------------------E-TSDVEYTSAAFHPDGLIFGTGTPD-GVVKIWDLKSQTNVAKFPGHTGPVK 393 (506)
T ss_pred EEEee-----------------------c-cccceeEEeeEcCCceEEeccCCC-ceEEEEEcCCccccccCCCCCCcee
Confidence 22111 1 123468999999999999999999 799999999887543 556889999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc--cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEE----eCCCCCCC
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS--STSGFVTGATWDPEGRMILLAFAGSLTLGSIH----FASKPPSL 332 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~--~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~----~~~~~~~~ 332 (350)
.++|+.+|-||+++++|+.|++||++.-+..+.. .....+.++.|.+.|++|+.+ +.+.+++..+ -|.....+
T Consensus 394 ~i~FsENGY~Lat~add~~V~lwDLRKl~n~kt~~l~~~~~v~s~~fD~SGt~L~~~-g~~l~Vy~~~k~~k~W~~~~~~ 472 (506)
T KOG0289|consen 394 AISFSENGYWLATAADDGSVKLWDLRKLKNFKTIQLDEKKEVNSLSFDQSGTYLGIA-GSDLQVYICKKKTKSWTEIKEL 472 (506)
T ss_pred EEEeccCceEEEEEecCCeEEEEEehhhcccceeeccccccceeEEEcCCCCeEEee-cceeEEEEEecccccceeeehh
Confidence 9999999999999999999999999887653322 223369999999999999987 5567888887 66666566
Q ss_pred ceeeccccccee
Q 018806 333 DAHLLPVDLPDI 344 (350)
Q Consensus 333 ~~~~~~v~~~~~ 344 (350)
..|....++-.+
T Consensus 473 ~~~sg~st~v~F 484 (506)
T KOG0289|consen 473 ADHSGLSTGVRF 484 (506)
T ss_pred hhcccccceeee
Confidence 666654444433
No 51
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.92 E-value=1.3e-23 Score=167.81 Aligned_cols=202 Identities=17% Similarity=0.254 Sum_probs=156.6
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccC---------------CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEe
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYED---------------SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVG 163 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~---------------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~ 163 (350)
..++++.+|||||.++|+|+.|..|+|+|++. .....+......|...|+.+.|+|....|++++
T Consensus 112 K~~cR~aafs~DG~lvATGsaD~SIKildvermlaks~~~em~~~~~qa~hPvIRTlYDH~devn~l~FHPre~ILiS~s 191 (430)
T KOG0640|consen 112 KSPCRAAAFSPDGSLVATGSADASIKILDVERMLAKSKPKEMISGDTQARHPVIRTLYDHVDEVNDLDFHPRETILISGS 191 (430)
T ss_pred ccceeeeeeCCCCcEEEccCCcceEEEeehhhhhhhcchhhhccCCcccCCceEeehhhccCcccceeecchhheEEecc
Confidence 34799999999999999999999999999861 111123344458999999999999966666666
Q ss_pred cCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC
Q 018806 164 CKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 164 ~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~ 243 (350)
.|++|+++|+........+ +.++.- ..|.+++|+|.|.+|+.+.... ++++||++
T Consensus 192 rD~tvKlFDfsK~saKrA~----------------------K~~qd~--~~vrsiSfHPsGefllvgTdHp-~~rlYdv~ 246 (430)
T KOG0640|consen 192 RDNTVKLFDFSKTSAKRAF----------------------KVFQDT--EPVRSISFHPSGEFLLVGTDHP-TLRLYDVN 246 (430)
T ss_pred CCCeEEEEecccHHHHHHH----------------------HHhhcc--ceeeeEeecCCCceEEEecCCC-ceeEEecc
Confidence 7999999999843222111 112222 5899999999999999999885 99999999
Q ss_pred CCCce----eeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc--cC-CCCeEEEEEcCCCCEEEEEECC
Q 018806 244 QGLGT----PIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS--ST-SGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 244 ~~~~~----~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~--~~-~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
+-++. +-..|.+.|+++.+++.|++.++++.||.|++||--++++.... .| ...|.+..|..+|++|++++ .
T Consensus 247 T~QcfvsanPd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG-~ 325 (430)
T KOG0640|consen 247 TYQCFVSANPDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSNRCVRTIGNAHGGSEVCSAVFTKNGKYILSSG-K 325 (430)
T ss_pred ceeEeeecCcccccccceeEEEecCCccEEEEeccCCcEEeeccccHHHHHHHHhhcCCceeeeEEEccCCeEEeecC-C
Confidence 98764 23457789999999999999999999999999999888885443 33 45799999999999999765 2
Q ss_pred CeEEEEEEeC
Q 018806 317 SLTLGSIHFA 326 (350)
Q Consensus 317 ~~~~~~~~~~ 326 (350)
+..+..|.+.
T Consensus 326 DS~vkLWEi~ 335 (430)
T KOG0640|consen 326 DSTVKLWEIS 335 (430)
T ss_pred cceeeeeeec
Confidence 3344444443
No 52
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.92 E-value=8.1e-23 Score=159.94 Aligned_cols=212 Identities=15% Similarity=0.131 Sum_probs=170.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+++.+.++.+|.+|.+++.|.+..+|--. +|+.+-.+ .+|.+.|+++...-+.+++++++.|.++++||++.++...
T Consensus 12 plTqiKyN~eGDLlFscaKD~~~~vw~s~--nGerlGty-~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la 88 (327)
T KOG0643|consen 12 PLTQIKYNREGDLLFSCAKDSTPTVWYSL--NGERLGTY-DGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLA 88 (327)
T ss_pred ccceEEecCCCcEEEEecCCCCceEEEec--CCceeeee-cCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEE
Confidence 48999999999999999999999999873 37776666 5999999999999998899999999999999999887776
Q ss_pred eeecccccccceecCCCCCc-------------eEE---------------eeeccCCCCCceeeEEECCCCCeEEEEEe
Q 018806 181 SVRSGAASFLGALSRGPGTR-------------WTL---------------VDFLRSQNGEQITALSWGPDGRYLASASY 232 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~-------------~~~---------------~~~~~~~~~~~v~~~~~sp~g~~l~~~~~ 232 (350)
.+..........+.++..-- +.+ ...+..+ +..++.+-|.|-++.|+++..
T Consensus 89 ~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~-~skit~a~Wg~l~~~ii~Ghe 167 (327)
T KOG0643|consen 89 TWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTP-DSKITSALWGPLGETIIAGHE 167 (327)
T ss_pred EeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCC-ccceeeeeecccCCEEEEecC
Confidence 66554332222222222111 001 1122333 368899999999999999999
Q ss_pred CCCeEEEEeCCCCCcee--eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEE
Q 018806 233 ESSSFTIWDVAQGLGTP--IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMI 310 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~--~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l 310 (350)
+ |.|.+||+++++... ...|...|..+++++|..++++++.|.+-++||+.+-++........+|.+.+++|--..+
T Consensus 168 ~-G~is~~da~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~Dttakl~D~~tl~v~Kty~te~PvN~aaisP~~d~V 246 (327)
T KOG0643|consen 168 D-GSISIYDARTGKELVDSDEEHSSKINDLQFSRDRTYFITGSKDTTAKLVDVRTLEVLKTYTTERPVNTAAISPLLDHV 246 (327)
T ss_pred C-CcEEEEEcccCceeeechhhhccccccccccCCcceEEecccCccceeeeccceeeEEEeeecccccceecccccceE
Confidence 9 799999999986543 3457789999999999999999999999999999999988777788899999999998888
Q ss_pred EEEECCC
Q 018806 311 LLAFAGS 317 (350)
Q Consensus 311 ~~~~~~~ 317 (350)
+.+++..
T Consensus 247 ilgGGqe 253 (327)
T KOG0643|consen 247 ILGGGQE 253 (327)
T ss_pred EecCCce
Confidence 8876554
No 53
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.92 E-value=3.3e-24 Score=172.20 Aligned_cols=200 Identities=17% Similarity=0.165 Sum_probs=162.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEe-------cCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEec
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACIL-------TSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAP 173 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~-------~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~ 173 (350)
.+.|..|||||++|++|+.||.|.+|++.+ |+...-+ +.-++..|.|+.|+.|...+++++.||.|++|.+
T Consensus 215 h~EcA~FSPDgqyLvsgSvDGFiEVWny~~--GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri 292 (508)
T KOG0275|consen 215 HVECARFSPDGQYLVSGSVDGFIEVWNYTT--GKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRI 292 (508)
T ss_pred chhheeeCCCCceEeeccccceeeeehhcc--chhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEE
Confidence 689999999999999999999999999854 4322211 1136789999999999777777778999999999
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRR 252 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~ 252 (350)
.++.+...+. +.|. ..|+++.||.|+..+++++.|. ++++--+++|++.. +.+
T Consensus 293 ~tG~ClRrFd------------------------rAHt-kGvt~l~FSrD~SqiLS~sfD~-tvRiHGlKSGK~LKEfrG 346 (508)
T KOG0275|consen 293 ETGQCLRRFD------------------------RAHT-KGVTCLSFSRDNSQILSASFDQ-TVRIHGLKSGKCLKEFRG 346 (508)
T ss_pred ecchHHHHhh------------------------hhhc-cCeeEEEEccCcchhhcccccc-eEEEeccccchhHHHhcC
Confidence 9776654432 2454 7999999999999999999995 99999999998764 778
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc---cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS---STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~---~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
|...|....|.+||..+++++.||+|++|+.++.++.... +...+|.++..-|...--++.|+....++...+.++
T Consensus 347 HsSyvn~a~ft~dG~~iisaSsDgtvkvW~~KtteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iVCNrsntv~imn~qGQ 425 (508)
T KOG0275|consen 347 HSSYVNEATFTDDGHHIISASSDGTVKVWHGKTTECLSTFKPLGTDYPVNSVILLPKNPEHFIVCNRSNTVYIMNMQGQ 425 (508)
T ss_pred ccccccceEEcCCCCeEEEecCCccEEEecCcchhhhhhccCCCCcccceeEEEcCCCCceEEEEcCCCeEEEEeccce
Confidence 8899999999999999999999999999999999985432 456678888887765444445566667777777654
No 54
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.91 E-value=1.8e-23 Score=187.57 Aligned_cols=217 Identities=15% Similarity=0.178 Sum_probs=178.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
+..|.+++|+|...+|+++--.|.|++||..- +..+..+ ..|+++|..++|+|+...++++|.|.+|+||+....+
T Consensus 9 SsRvKglsFHP~rPwILtslHsG~IQlWDYRM--~tli~rF-deHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rr- 84 (1202)
T KOG0292|consen 9 SSRVKGLSFHPKRPWILTSLHSGVIQLWDYRM--GTLIDRF-DEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRR- 84 (1202)
T ss_pred cccccceecCCCCCEEEEeecCceeeeehhhh--hhHHhhh-hccCCccceeeecCCCCeEEecCCccEEEEEecccce-
Confidence 34699999999999999999999999999853 5555555 4899999999999997777788888999999998443
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
+..++.||- .-|..+.|++.-.+|++++.| .+|+||+..++++.. +.+|...|
T Consensus 85 ------------------------clftL~GHl-DYVRt~~FHheyPWIlSASDD-QTIrIWNwqsr~~iavltGHnHYV 138 (1202)
T KOG0292|consen 85 ------------------------CLFTLLGHL-DYVRTVFFHHEYPWILSASDD-QTIRIWNWQSRKCIAVLTGHNHYV 138 (1202)
T ss_pred ------------------------ehhhhcccc-ceeEEeeccCCCceEEEccCC-CeEEEEeccCCceEEEEecCceEE
Confidence 456688887 699999999999999999999 599999999999876 55788999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce------------------------------eccccCCCCeEEEEEcCCC
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS------------------------------EPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~------------------------------~~~~~~~~~v~~~~~s~~g 307 (350)
.|.+|+|....++++|.|.+|+|||+..-+. ..+.+|...|.-++|+|.-
T Consensus 139 McAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwaAfhpTl 218 (1202)
T KOG0292|consen 139 MCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWAAFHPTL 218 (1202)
T ss_pred EeeccCCccceEEEecccceEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeeeeeeecccccccceEEecCCc
Confidence 9999999999999999999999999864211 0123688889999999999
Q ss_pred CEEEEEECCCeEEEEEEeCCCCC----CCceeecccccceeec
Q 018806 308 RMILLAFAGSLTLGSIHFASKPP----SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 308 ~~l~~~~~~~~~~~~~~~~~~~~----~~~~~~~~v~~~~~~~ 346 (350)
..|++|+|+. .+..|++...+. +..+|..+|.+.-+++
T Consensus 219 pliVSG~DDR-qVKlWrmnetKaWEvDtcrgH~nnVssvlfhp 260 (1202)
T KOG0292|consen 219 PLIVSGADDR-QVKLWRMNETKAWEVDTCRGHYNNVSSVLFHP 260 (1202)
T ss_pred ceEEecCCcc-eeeEEEeccccceeehhhhcccCCcceEEecC
Confidence 9998887543 566666654332 6679999998776654
No 55
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.91 E-value=1.6e-23 Score=177.56 Aligned_cols=216 Identities=15% Similarity=0.226 Sum_probs=159.4
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCC--ceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGK--DACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~--~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
..|.++++.|.|-++++|+.|.+|++||+..-+.. ....+.......|++++|++.|..|++.+.....+|+|-. +.
T Consensus 168 k~Vsal~~Dp~GaR~~sGs~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~aqakl~DRd-G~ 246 (641)
T KOG0772|consen 168 KIVSALAVDPSGARFVSGSLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGSAQAKLLDRD-GF 246 (641)
T ss_pred eEEEEeeecCCCceeeeccccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecCcceeEEccC-Cc
Confidence 36999999999999999999999999999632221 2223333455679999999999999999999999999976 22
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCC-eEEEEEeCCCeEEEEeCCCCCc-eeeeec--
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGR-YLASASYESSSFTIWDVAQGLG-TPIRRG-- 253 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~-~l~~~~~d~g~i~iwd~~~~~~-~~~~~~-- 253 (350)
....+..+ +.-+.-....+||. ..+++.+|+|+.+ .+++++.| |++++||++..+. ..++.+
T Consensus 247 ~~~e~~KG------------DQYI~Dm~nTKGHi-a~lt~g~whP~~k~~FlT~s~D-gtlRiWdv~~~k~q~qVik~k~ 312 (641)
T KOG0772|consen 247 EIVEFSKG------------DQYIRDMYNTKGHI-AELTCGCWHPDNKEEFLTCSYD-GTLRIWDVNNTKSQLQVIKTKP 312 (641)
T ss_pred eeeeeecc------------chhhhhhhccCCce-eeeeccccccCcccceEEecCC-CcEEEEecCCchhheeEEeecc
Confidence 22221111 11111223456776 7899999999754 57788888 7999999987643 223322
Q ss_pred ----CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec----cccCCC--CeEEEEEcCCCCEEEEEE-CCCeEEEE
Q 018806 254 ----FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP----WSSTSG--FVTGATWDPEGRMILLAF-AGSLTLGS 322 (350)
Q Consensus 254 ----~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~----~~~~~~--~v~~~~~s~~g~~l~~~~-~~~~~~~~ 322 (350)
.-.+..++|+|||++||+|..||.|.+|+..+..... -..|.. .|++++||+||++|++-+ ++...+|+
T Consensus 313 ~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~tLKvWD 392 (641)
T KOG0772|consen 313 AGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDTLKVWD 392 (641)
T ss_pred CCCcccCceeeecCCCcchhhhcccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhccCCCceeeee
Confidence 2458899999999999999999999999986655432 225655 899999999999999876 66677777
Q ss_pred EEeCCCCC
Q 018806 323 IHFASKPP 330 (350)
Q Consensus 323 ~~~~~~~~ 330 (350)
++-..++.
T Consensus 393 Lrq~kkpL 400 (641)
T KOG0772|consen 393 LRQFKKPL 400 (641)
T ss_pred ccccccch
Confidence 76665543
No 56
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.91 E-value=8.2e-23 Score=178.03 Aligned_cols=216 Identities=19% Similarity=0.269 Sum_probs=171.9
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
+..|+++.|+++|++||+|..+|.+.|||... .+.+..+...|...|.+++|.. ..+.+++.++.|..+|++....
T Consensus 217 ~~~vtSv~ws~~G~~LavG~~~g~v~iwD~~~--~k~~~~~~~~h~~rvg~laW~~--~~lssGsr~~~I~~~dvR~~~~ 292 (484)
T KOG0305|consen 217 EELVTSVKWSPDGSHLAVGTSDGTVQIWDVKE--QKKTRTLRGSHASRVGSLAWNS--SVLSSGSRDGKILNHDVRISQH 292 (484)
T ss_pred CCceEEEEECCCCCEEEEeecCCeEEEEehhh--ccccccccCCcCceeEEEeccC--ceEEEecCCCcEEEEEEecchh
Confidence 45799999999999999999999999999854 4555555434999999999982 4566666689999999985543
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeeeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~~~~~~v 257 (350)
.. ..+.+|. ..|..++|++|++++|+++.|+ .+.|||...... ..+..|...|
T Consensus 293 ~~------------------------~~~~~H~-qeVCgLkws~d~~~lASGgnDN-~~~Iwd~~~~~p~~~~~~H~aAV 346 (484)
T KOG0305|consen 293 VV------------------------STLQGHR-QEVCGLKWSPDGNQLASGGNDN-VVFIWDGLSPEPKFTFTEHTAAV 346 (484)
T ss_pred hh------------------------hhhhccc-ceeeeeEECCCCCeeccCCCcc-ceEeccCCCccccEEEeccceee
Confidence 21 1256675 7999999999999999999995 999999965544 4577899999
Q ss_pred EEEEEcC-CCCEEEEE--ecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCC--CCC
Q 018806 258 SILKWSP-TGDYFFAA--KFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASK--PPS 331 (350)
Q Consensus 258 ~~~~~sp-~g~~l~~~--~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~--~~~ 331 (350)
..++|+| ....||+| +.|+.|++||..+++..........|.++.|++..+-|+++. .....+..|++... ...
T Consensus 347 KA~awcP~q~~lLAsGGGs~D~~i~fwn~~~g~~i~~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~ 426 (484)
T KOG0305|consen 347 KALAWCPWQSGLLATGGGSADRCIKFWNTNTGARIDSVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAE 426 (484)
T ss_pred eEeeeCCCccCceEEcCCCcccEEEEEEcCCCcEecccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeee
Confidence 9999999 46678876 459999999999999988888889999999999998888876 33344455555443 347
Q ss_pred Cceeeccccccee
Q 018806 332 LDAHLLPVDLPDI 344 (350)
Q Consensus 332 ~~~~~~~v~~~~~ 344 (350)
+.+|..+|-...+
T Consensus 427 l~gH~~RVl~la~ 439 (484)
T KOG0305|consen 427 LLGHTSRVLYLAL 439 (484)
T ss_pred ecCCcceeEEEEE
Confidence 7899888754433
No 57
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.91 E-value=3.1e-23 Score=160.28 Aligned_cols=209 Identities=19% Similarity=0.338 Sum_probs=157.5
Q ss_pred ccchhhhhhhhhhccccccCCCCcCCCCccCeeEEEEec--CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCee
Q 018806 71 EGLFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQ--HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVK 148 (350)
Q Consensus 71 ~~~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp--~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~ 148 (350)
..++..|.||.+. |+.++|.. .|.+||+++.||.|.||.-....-.+.... ..|...|+
T Consensus 46 s~ll~~L~Gh~GP------------------Vwqv~wahPk~G~iLAScsYDgkVIiWke~~g~w~k~~e~-~~h~~SVN 106 (299)
T KOG1332|consen 46 SKLLAELTGHSGP------------------VWKVAWAHPKFGTILASCSYDGKVIIWKEENGRWTKAYEH-AAHSASVN 106 (299)
T ss_pred ceeeeEecCCCCC------------------eeEEeecccccCcEeeEeecCceEEEEecCCCchhhhhhh-hhhcccce
Confidence 4678889999877 77778754 799999999999999999865433333333 36999999
Q ss_pred EEEEeeC--CCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC---
Q 018806 149 VLEWRPN--GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--- 223 (350)
Q Consensus 149 ~~~~sp~--~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--- 223 (350)
+++|.|. |-.|+++++||.|.|.+++..+ .|...+....|. -.|++++|.|-
T Consensus 107 sV~wapheygl~LacasSDG~vsvl~~~~~g----------------------~w~t~ki~~aH~-~GvnsVswapa~~~ 163 (299)
T KOG1332|consen 107 SVAWAPHEYGLLLACASSDGKVSVLTYDSSG----------------------GWTTSKIVFAHE-IGVNSVSWAPASAP 163 (299)
T ss_pred eecccccccceEEEEeeCCCcEEEEEEcCCC----------------------Cccchhhhhccc-cccceeeecCcCCC
Confidence 9999987 3356667779999999998442 122223345565 68999999985
Q ss_pred C-----------CeEEEEEeCCCeEEEEeCCCCCc---eeeeecCCCeEEEEEcCCC----CEEEEEecCCeEEEEeCCC
Q 018806 224 G-----------RYLASASYESSSFTIWDVAQGLG---TPIRRGFGGLSILKWSPTG----DYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 224 g-----------~~l~~~~~d~g~i~iwd~~~~~~---~~~~~~~~~v~~~~~sp~g----~~l~~~~~d~~v~iwd~~~ 285 (350)
| +.|++++.|+ .|+||+...+.- ..+..|.+.|+.++|.|.- .+||+++.||+|.||-.+.
T Consensus 164 g~~~~~~~~~~~krlvSgGcDn-~VkiW~~~~~~w~~e~~l~~H~dwVRDVAwaP~~gl~~s~iAS~SqDg~viIwt~~~ 242 (299)
T KOG1332|consen 164 GSLVDQGPAAKVKRLVSGGCDN-LVKIWKFDSDSWKLERTLEGHKDWVRDVAWAPSVGLPKSTIASCSQDGTVIIWTKDE 242 (299)
T ss_pred ccccccCcccccceeeccCCcc-ceeeeecCCcchhhhhhhhhcchhhhhhhhccccCCCceeeEEecCCCcEEEEEecC
Confidence 5 6799999996 999999998642 3366789999999999963 4689999999999997762
Q ss_pred C----ceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEE
Q 018806 286 W----TSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGS 322 (350)
Q Consensus 286 ~----~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~ 322 (350)
. +...+......+++++||..|..|++++ ++..++|.
T Consensus 243 e~e~wk~tll~~f~~~~w~vSWS~sGn~LaVs~GdNkvtlwk 284 (299)
T KOG1332|consen 243 EYEPWKKTLLEEFPDVVWRVSWSLSGNILAVSGGDNKVTLWK 284 (299)
T ss_pred ccCcccccccccCCcceEEEEEeccccEEEEecCCcEEEEEE
Confidence 2 1122345667899999999999999876 33344443
No 58
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.91 E-value=1.4e-21 Score=156.59 Aligned_cols=215 Identities=15% Similarity=0.197 Sum_probs=159.6
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCC-----------------------------------------cee
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGK-----------------------------------------DAC 137 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~-----------------------------------------~~~ 137 (350)
...|.++.|+++|.+|++++.|.+++|||....... ...
T Consensus 14 ~~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~skkyG~~~~~Fth~~~~~i~sStk~d~tIryLsl~dNkyl 93 (311)
T KOG1446|consen 14 NGKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINSKKYGVDLACFTHHSNTVIHSSTKEDDTIRYLSLHDNKYL 93 (311)
T ss_pred CCceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeecccccccEEEEecCCceEEEccCCCCCceEEEEeecCceE
Confidence 456999999999999999999999999997531110 111
Q ss_pred EecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecc-----cccccce-ecCCCCC-ceEEeee----
Q 018806 138 ILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSG-----AASFLGA-LSRGPGT-RWTLVDF---- 206 (350)
Q Consensus 138 ~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~-----~~~~~~~-~~~~~~~-~~~~~~~---- 206 (350)
+.+.+|...|.+++.+|-+..+++++.|++|++||++...+...+... ++.+.+- ++..... .+++.+.
T Consensus 94 RYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~~~~pi~AfDp~GLifA~~~~~~~IkLyD~Rs~d 173 (311)
T KOG1446|consen 94 RYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNLSGRPIAAFDPEGLIFALANGSELIKLYDLRSFD 173 (311)
T ss_pred EEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEecCCCcceeECCCCcEEEEecCCCeEEEEEecccC
Confidence 445689999999999999999999999999999999977666555433 2233332 2222222 3333321
Q ss_pred --------ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee-cC--C-CeEEEEEcCCCCEEEEEec
Q 018806 207 --------LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR-GF--G-GLSILKWSPTGDYFFAAKF 274 (350)
Q Consensus 207 --------~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~-~~--~-~v~~~~~sp~g~~l~~~~~ 274 (350)
+........+.+.|||||+.|+.++.. +.+++.|.-+|....... +. + -....+|+||++++++|+.
T Consensus 174 kgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~-s~~~~lDAf~G~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~gs~ 252 (311)
T KOG1446|consen 174 KGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNA-SFIYLLDAFDGTVKSTFSGYPNAGNLPLSATFTPDSKFVLSGSD 252 (311)
T ss_pred CCCceeEccCCCCccceeeeEEcCCCCEEEEEeCC-CcEEEEEccCCcEeeeEeeccCCCCcceeEEECCCCcEEEEecC
Confidence 111112578899999999999999988 599999999998655333 22 2 2357899999999999999
Q ss_pred CCeEEEEeCCCCcee-cccc-CCCCeEEEEEcCCCCEEEEEE
Q 018806 275 DGTFYLWETNTWTSE-PWSS-TSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 275 d~~v~iwd~~~~~~~-~~~~-~~~~v~~~~~s~~g~~l~~~~ 314 (350)
||+|++|++++++.. .+.+ +..++.++.|+|.-.++++++
T Consensus 253 dg~i~vw~~~tg~~v~~~~~~~~~~~~~~~fnP~~~mf~sa~ 294 (311)
T KOG1446|consen 253 DGTIHVWNLETGKKVAVLRGPNGGPVSCVRFNPRYAMFVSAS 294 (311)
T ss_pred CCcEEEEEcCCCcEeeEecCCCCCCccccccCCceeeeeecC
Confidence 999999999999873 4554 688899999999877777653
No 59
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.91 E-value=7.7e-22 Score=167.67 Aligned_cols=216 Identities=19% Similarity=0.323 Sum_probs=163.5
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..+..+.|+|++++|++++.++.+++|++.. ++....+ ..|...+.++.|++++..+++++.++.+++||+.....
T Consensus 52 ~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~--~~~~~~~-~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~- 127 (289)
T cd00200 52 GPVRDVAASADGTYLASGSSDKTIRLWDLET--GECVRTL-TGHTSYVSSVAFSPDGRILSSSSRDKTIKVWDVETGKC- 127 (289)
T ss_pred cceeEEEECCCCCEEEEEcCCCeEEEEEcCc--ccceEEE-eccCCcEEEEEEcCCCCEEEEecCCCeEEEEECCCcEE-
Confidence 3578999999999999999999999999964 3344444 36788999999999955444444489999999973221
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~ 258 (350)
...+..|. ..+.+++|+|+++++++++.+ |.|++||+++++... +..+...+.
T Consensus 128 ------------------------~~~~~~~~-~~i~~~~~~~~~~~l~~~~~~-~~i~i~d~~~~~~~~~~~~~~~~i~ 181 (289)
T cd00200 128 ------------------------LTTLRGHT-DWVNSVAFSPDGTFVASSSQD-GTIKLWDLRTGKCVATLTGHTGEVN 181 (289)
T ss_pred ------------------------EEEeccCC-CcEEEEEEcCcCCEEEEEcCC-CcEEEEEccccccceeEecCccccc
Confidence 22344454 689999999998888888767 699999999776554 345667899
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceee
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHL 336 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~ 336 (350)
+++|+|+++.+++++.++.|++||+++++... +..+...+.+++|+|++.+++++. ++.+.+|.+........+..|.
T Consensus 182 ~~~~~~~~~~l~~~~~~~~i~i~d~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~i~~~~~~~~~~~~~~~~ 261 (289)
T cd00200 182 SVAFSPDGEKLLSSSSDGTIKLWDLSTGKCLGTLRGHENGVNSVAFSPDGYLLASGSEDGTIRVWDLRTGECVQTLSGHT 261 (289)
T ss_pred eEEECCCcCEEEEecCCCcEEEEECCCCceecchhhcCCceEEEEEcCCCcEEEEEcCCCcEEEEEcCCceeEEEccccC
Confidence 99999999999999999999999999887754 447888999999999988888776 5555555544333333455666
Q ss_pred cccccceee
Q 018806 337 LPVDLPDIV 345 (350)
Q Consensus 337 ~~v~~~~~~ 345 (350)
.++....+.
T Consensus 262 ~~i~~~~~~ 270 (289)
T cd00200 262 NSVTSLAWS 270 (289)
T ss_pred CcEEEEEEC
Confidence 566554443
No 60
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.91 E-value=2.6e-22 Score=160.92 Aligned_cols=223 Identities=19% Similarity=0.294 Sum_probs=149.2
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCc-----------------
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKD----------------- 135 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~----------------- 135 (350)
...+|.||.++ |++++|+.||++||+++.|+.|+||++.....+.
T Consensus 78 ~~~~LKgH~~~------------------vt~~~FsSdGK~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~dhpT~V~ 139 (420)
T KOG2096|consen 78 NVSVLKGHKKE------------------VTDVAFSSDGKKLATISGDRSIRLWDVRDFENKEHRCIRQNVEYDHPTRVV 139 (420)
T ss_pred hhhhhhccCCc------------------eeeeEEcCCCceeEEEeCCceEEEEecchhhhhhhhHhhccccCCCceEEE
Confidence 36777777655 9999999999999999999999999986321111
Q ss_pred -----------------eeE----------------------ecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 136 -----------------ACI----------------------LTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 136 -----------------~~~----------------------~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
++. +...|.-.|.++-...++..+.+++.|.+|.+|++. +
T Consensus 140 FapDc~s~vv~~~~g~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lk-G 218 (420)
T KOG2096|consen 140 FAPDCKSVVVSVKRGNKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLK-G 218 (420)
T ss_pred ECCCcceEEEEEccCCEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecC-C
Confidence 000 000122233333444444555666667888888887 5
Q ss_pred CCCceeecc-------cccccceec----CCCCCc-eE-------------EeeeccCCCCCceeeEEECCCCCeEEEEE
Q 018806 177 GNAASVRSG-------AASFLGALS----RGPGTR-WT-------------LVDFLRSQNGEQITALSWGPDGRYLASAS 231 (350)
Q Consensus 177 ~~~~~~~~~-------~~~~~~~~~----~~~~~~-~~-------------~~~~~~~~~~~~v~~~~~sp~g~~l~~~~ 231 (350)
+....+.+. ..++.+.|. +.++-+ |. -...++||. ..|..++|+++.+.+++.+
T Consensus 219 q~L~~idtnq~~n~~aavSP~GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~-saV~~~aFsn~S~r~vtvS 297 (420)
T KOG2096|consen 219 QLLQSIDTNQSSNYDAAVSPDGRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQ-SAVLAAAFSNSSTRAVTVS 297 (420)
T ss_pred ceeeeeccccccccceeeCCCCcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccch-hheeeeeeCCCcceeEEEe
Confidence 544444332 122222211 111111 11 112578886 7999999999999999999
Q ss_pred eCCCeEEEEeCCCC----Cc--------eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecc--ccCCCC
Q 018806 232 YESSSFTIWDVAQG----LG--------TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPW--SSTSGF 297 (350)
Q Consensus 232 ~d~g~i~iwd~~~~----~~--------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~--~~~~~~ 297 (350)
.| |++++||++-. +- .++....+....+.++|+|+.||.+. ...+++|..++++.... ..|...
T Consensus 298 kD-G~wriwdtdVrY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s~-gs~l~~~~se~g~~~~~~e~~h~~~ 375 (420)
T KOG2096|consen 298 KD-GKWRIWDTDVRYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVSF-GSDLKVFASEDGKDYPELEDIHSTT 375 (420)
T ss_pred cC-CcEEEeeccceEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEeec-CCceEEEEcccCccchhHHHhhcCc
Confidence 99 79999998642 11 11112234456899999999887654 56899999999887543 368899
Q ss_pred eEEEEEcCCCCEEEEEECCC
Q 018806 298 VTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 298 v~~~~~s~~g~~l~~~~~~~ 317 (350)
|++++|+++|++++++++.-
T Consensus 376 Is~is~~~~g~~~atcGdr~ 395 (420)
T KOG2096|consen 376 ISSISYSSDGKYIATCGDRY 395 (420)
T ss_pred eeeEEecCCCcEEeeeccee
Confidence 99999999999999886544
No 61
>PTZ00421 coronin; Provisional
Probab=99.91 E-value=4.4e-22 Score=179.13 Aligned_cols=193 Identities=14% Similarity=0.193 Sum_probs=140.4
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccC--------CCCCce--eEecCCCCCCeeEEEEee-CCCeEEEEecCCcEEE
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYED--------SEGKDA--CILTSDSQRDVKVLEWRP-NGGRSLSVGCKGGICI 170 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~--------~~~~~~--~~~~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~i 170 (350)
|+....++++..+++++.+.....|+... ..++.. .....+|.+.|.+++|+| +++.|++++.|++|++
T Consensus 23 i~~~~~~~d~~~~~~~n~~~~a~~w~~~gg~~v~~~~~~G~~~~~~~~l~GH~~~V~~v~fsP~d~~~LaSgS~DgtIkI 102 (493)
T PTZ00421 23 VTPSTALWDCSNTIACNDRFIAVPWQQLGSTAVLKHTDYGKLASNPPILLGQEGPIIDVAFNPFDPQKLFTASEDGTIMG 102 (493)
T ss_pred cccccccCCCCCcEeECCceEEEEEecCCceEEeeccccccCCCCCceEeCCCCCEEEEEEcCCCCCEEEEEeCCCEEEE
Confidence 44445555655555555555555565321 111111 112357999999999999 7778888888999999
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCCCcee
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVAQGLGTP 249 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~~~~~ 249 (350)
||+...+..... ......+.+|. ..|.+++|+|++ ..|++++.| |+|++||+++++...
T Consensus 103 Wdi~~~~~~~~~------------------~~~l~~L~gH~-~~V~~l~f~P~~~~iLaSgs~D-gtVrIWDl~tg~~~~ 162 (493)
T PTZ00421 103 WGIPEEGLTQNI------------------SDPIVHLQGHT-KKVGIVSFHPSAMNVLASAGAD-MVVNVWDVERGKAVE 162 (493)
T ss_pred EecCCCcccccc------------------CcceEEecCCC-CcEEEEEeCcCCCCEEEEEeCC-CEEEEEECCCCeEEE
Confidence 999743321110 01234577886 799999999985 688999999 699999999887654
Q ss_pred -eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCC-eEEEEEcCCCCEEEEEE
Q 018806 250 -IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGF-VTGATWDPEGRMILLAF 314 (350)
Q Consensus 250 -~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~-v~~~~~s~~g~~l~~~~ 314 (350)
+..|...|.+++|+|+|.+|++++.|++|++||+++++.. .+..|.+. +..+.|.+++..|++++
T Consensus 163 ~l~~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~~~~~~ivt~G 230 (493)
T PTZ00421 163 VIKCHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWAKRKDLIITLG 230 (493)
T ss_pred EEcCCCCceEEEEEECCCCEEEEecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEcCCCCeEEEEe
Confidence 4457788999999999999999999999999999998873 45566554 45788999988887765
No 62
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.90 E-value=8.9e-22 Score=157.54 Aligned_cols=198 Identities=21% Similarity=0.304 Sum_probs=154.0
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC--eEEEEecCCcEEEEecCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG--RSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~--~l~~~~~d~~v~iwd~~~~ 176 (350)
...+++++. ++.++|+|+.|-+|+|||+.. ......+ ..|.+.|+++.|.++-. +|++++.||.|.+|+..
T Consensus 43 ~~sitavAV--s~~~~aSGssDetI~IYDm~k--~~qlg~l-l~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~-- 115 (362)
T KOG0294|consen 43 AGSITALAV--SGPYVASGSSDETIHIYDMRK--RKQLGIL-LSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVG-- 115 (362)
T ss_pred ccceeEEEe--cceeEeccCCCCcEEEEeccc--hhhhcce-eccccceEEEEecCCcchhheeeecCCCcEEEEEcC--
Confidence 445888887 579999999999999999953 4444444 36899999999998844 89999999999999998
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGG 256 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~ 256 (350)
.|.+...+++|. +.|+.++.+|.|+.-++.+.| +.+++||+-.|+...+..-...
T Consensus 116 -----------------------~W~~~~slK~H~-~~Vt~lsiHPS~KLALsVg~D-~~lr~WNLV~Gr~a~v~~L~~~ 170 (362)
T KOG0294|consen 116 -----------------------SWELLKSLKAHK-GQVTDLSIHPSGKLALSVGGD-QVLRTWNLVRGRVAFVLNLKNK 170 (362)
T ss_pred -----------------------CeEEeeeecccc-cccceeEecCCCceEEEEcCC-ceeeeehhhcCccceeeccCCc
Confidence 888899999998 679999999999999999999 6999999987754332222222
Q ss_pred eEEEEEcC---------------------------------------CCCEEEEEecCCeEEEEeCCCCce-eccccCCC
Q 018806 257 LSILKWSP---------------------------------------TGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSG 296 (350)
Q Consensus 257 v~~~~~sp---------------------------------------~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~ 296 (350)
...+.|+| ++..|++|.+|+.|.+||.++..+ ..+..|..
T Consensus 171 at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~i~~~~r~l~~~~l~~~~L~vG~d~~~i~~~D~ds~~~~~~~~AH~~ 250 (362)
T KOG0294|consen 171 ATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFREIENPKRILCATFLDGSELLVGGDNEWISLKDTDSDTPLTEFLAHEN 250 (362)
T ss_pred ceeeEEcCCCCEEEEEeccEEEEEecccHhHhhhhhccccceeeeecCCceEEEecCCceEEEeccCCCccceeeecchh
Confidence 22233333 345677788888999999988666 45678999
Q ss_pred CeEEEEE--cCCCCEEEEEE-CCCeEEEEEEeCCC
Q 018806 297 FVTGATW--DPEGRMILLAF-AGSLTLGSIHFASK 328 (350)
Q Consensus 297 ~v~~~~~--s~~g~~l~~~~-~~~~~~~~~~~~~~ 328 (350)
.|-++.+ .|++.+|++++ ++.+.+|.+++..+
T Consensus 251 RVK~i~~~~~~~~~~lvTaSSDG~I~vWd~~~~~k 285 (362)
T KOG0294|consen 251 RVKDIASYTNPEHEYLVTASSDGFIKVWDIDMETK 285 (362)
T ss_pred heeeeEEEecCCceEEEEeccCceEEEEEcccccc
Confidence 9999884 56788888887 66677777777644
No 63
>PTZ00420 coronin; Provisional
Probab=99.90 E-value=1.2e-21 Score=177.25 Aligned_cols=176 Identities=14% Similarity=0.179 Sum_probs=133.8
Q ss_pred EECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC-CCeEEEEecCCcEEEEecCCCCCC-ceeecccccccceec
Q 018806 117 ISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN-GGRSLSVGCKGGICIWAPSYPGNA-ASVRSGAASFLGALS 194 (350)
Q Consensus 117 ~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~~~~~~~~ 194 (350)
|+.++.+++|+... ......+ .+|.+.|.+++|+|+ +..+++++.|++|+|||+...... ..+.
T Consensus 50 GG~~gvI~L~~~~r--~~~v~~L-~gH~~~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~----------- 115 (568)
T PTZ00420 50 GGLIGAIRLENQMR--KPPVIKL-KGHTSSILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIK----------- 115 (568)
T ss_pred CCceeEEEeeecCC--CceEEEE-cCCCCCEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCccccccc-----------
Confidence 45678899999853 3333333 589999999999997 567778888999999999743221 1000
Q ss_pred CCCCCceEEeeeccCCCCCceeeEEECCCCCeE-EEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe
Q 018806 195 RGPGTRWTLVDFLRSQNGEQITALSWGPDGRYL-ASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK 273 (350)
Q Consensus 195 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l-~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~ 273 (350)
.....+.+|. ..|.+++|+|++..+ ++++.| |+|++||+++++......+...|.+++|+|+|++|++++
T Consensus 116 -------~p~~~L~gH~-~~V~sVaf~P~g~~iLaSgS~D-gtIrIWDl~tg~~~~~i~~~~~V~SlswspdG~lLat~s 186 (568)
T PTZ00420 116 -------DPQCILKGHK-KKISIIDWNPMNYYIMCSSGFD-SFVNIWDIENEKRAFQINMPKKLSSLKWNIKGNLLSGTC 186 (568)
T ss_pred -------cceEEeecCC-CcEEEEEECCCCCeEEEEEeCC-CeEEEEECCCCcEEEEEecCCcEEEEEECCCCCEEEEEe
Confidence 0123456775 699999999998865 677888 699999999987665555677899999999999999999
Q ss_pred cCCeEEEEeCCCCce-eccccCCCCeE-----EEEEcCCCCEEEEEEC
Q 018806 274 FDGTFYLWETNTWTS-EPWSSTSGFVT-----GATWDPEGRMILLAFA 315 (350)
Q Consensus 274 ~d~~v~iwd~~~~~~-~~~~~~~~~v~-----~~~~s~~g~~l~~~~~ 315 (350)
.|+.|+|||+++++. ..+..|.+.+. ...|++++.+|++++.
T Consensus 187 ~D~~IrIwD~Rsg~~i~tl~gH~g~~~s~~v~~~~fs~d~~~IlTtG~ 234 (568)
T PTZ00420 187 VGKHMHIIDPRKQEIASSFHIHDGGKNTKNIWIDGLGGDDNYILSTGF 234 (568)
T ss_pred cCCEEEEEECCCCcEEEEEecccCCceeEEEEeeeEcCCCCEEEEEEc
Confidence 999999999999887 44667776543 2345689999988773
No 64
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.90 E-value=2.3e-22 Score=174.30 Aligned_cols=193 Identities=15% Similarity=0.199 Sum_probs=160.7
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~~ 176 (350)
|..-+++++.||...+++++|.|-+|++||++. .-...+.+.+|..-|.+++|+|.+. .+++++-|++|+||.+..+
T Consensus 96 H~DyIR~iavHPt~P~vLtsSDDm~iKlW~we~--~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~ 173 (794)
T KOG0276|consen 96 HSDYIRSIAVHPTLPYVLTSSDDMTIKLWDWEN--EWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSP 173 (794)
T ss_pred cccceeeeeecCCCCeEEecCCccEEEEeeccC--ceeeeeEEcCcceEEEEEEecCCCccceeeeeccccEEEEEcCCC
Confidence 355799999999999999999999999999973 3333444569999999999999754 5666666999999999843
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC--CeEEEEEeCCCeEEEEeCCCCCcee-eeec
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG--RYLASASYESSSFTIWDVAQGLGTP-IRRG 253 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g--~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~ 253 (350)
.. ..++.+|. ..|.++.+-+.| .+|++++.|. +|++||.++..+.. +.+|
T Consensus 174 ~~-------------------------nfTl~gHe-kGVN~Vdyy~~gdkpylIsgaDD~-tiKvWDyQtk~CV~TLeGH 226 (794)
T KOG0276|consen 174 HP-------------------------NFTLEGHE-KGVNCVDYYTGGDKPYLISGADDL-TIKVWDYQTKSCVQTLEGH 226 (794)
T ss_pred CC-------------------------ceeeeccc-cCcceEEeccCCCcceEEecCCCc-eEEEeecchHHHHHHhhcc
Confidence 32 34577886 799999998754 6899999995 99999999999876 4568
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEECCCeE
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAFAGSLT 319 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~ 319 (350)
...|..++|+|.=.++++|++||+|+||+..+.+.. .+....+.+++++-.+.++.+++|.|....
T Consensus 227 t~Nvs~v~fhp~lpiiisgsEDGTvriWhs~Ty~lE~tLn~gleRvW~I~~~k~~~~i~vG~Deg~i 293 (794)
T KOG0276|consen 227 TNNVSFVFFHPELPIIISGSEDGTVRIWNSKTYKLEKTLNYGLERVWCIAAHKGDGKIAVGFDEGSV 293 (794)
T ss_pred cccceEEEecCCCcEEEEecCCccEEEecCcceehhhhhhcCCceEEEEeecCCCCeEEEeccCCcE
Confidence 899999999999999999999999999999998874 344566789999999998899988866543
No 65
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.90 E-value=1.5e-21 Score=188.63 Aligned_cols=191 Identities=14% Similarity=0.187 Sum_probs=151.1
Q ss_pred cCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEee-CCCeEEEEecCCcEEEEecCCCC
Q 018806 100 VDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRP-NGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
..|.+++|++ ++++||+++.||+|++||+.. ++....+ .+|.+.|++++|+| ++..+++++.|++|++||+....
T Consensus 533 ~~v~~l~~~~~~~~~las~~~Dg~v~lWd~~~--~~~~~~~-~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~ 609 (793)
T PLN00181 533 SKLSGICWNSYIKSQVASSNFEGVVQVWDVAR--SQLVTEM-KEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGV 609 (793)
T ss_pred CceeeEEeccCCCCEEEEEeCCCeEEEEECCC--CeEEEEe-cCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCc
Confidence 3578899987 478999999999999999953 4444444 58999999999997 66678888889999999998433
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC-CCCCeEEEEEeCCCeEEEEeCCCCCc--eeeeecC
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG-PDGRYLASASYESSSFTIWDVAQGLG--TPIRRGF 254 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s-p~g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~ 254 (350)
. ...+..+ ..+.++.|+ ++|.+|++++.| |.|++||++.... ..+..|.
T Consensus 610 ~-------------------------~~~~~~~--~~v~~v~~~~~~g~~latgs~d-g~I~iwD~~~~~~~~~~~~~h~ 661 (793)
T PLN00181 610 S-------------------------IGTIKTK--ANICCVQFPSESGRSLAFGSAD-HKVYYYDLRNPKLPLCTMIGHS 661 (793)
T ss_pred E-------------------------EEEEecC--CCeEEEEEeCCCCCEEEEEeCC-CeEEEEECCCCCccceEecCCC
Confidence 2 2223322 478899995 579999999999 6999999987652 3455688
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCC------c-eeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEE
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETNTW------T-SEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGS 322 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~------~-~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~ 322 (350)
..|.++.|. ++.+|++++.|++|++||++.+ + ...+.+|...+..++|+|++++|++++ ++.+.+|.
T Consensus 662 ~~V~~v~f~-~~~~lvs~s~D~~ikiWd~~~~~~~~~~~~l~~~~gh~~~i~~v~~s~~~~~lasgs~D~~v~iw~ 736 (793)
T PLN00181 662 KTVSYVRFV-DSSTLVSSSTDNTLKLWDLSMSISGINETPLHSFMGHTNVKNFVGLSVSDGYIATGSETNEVFVYH 736 (793)
T ss_pred CCEEEEEEe-CCCEEEEEECCCEEEEEeCCCCccccCCcceEEEcCCCCCeeEEEEcCCCCEEEEEeCCCEEEEEE
Confidence 899999997 7889999999999999999753 2 245668888999999999999999887 44444444
No 66
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.90 E-value=1.2e-23 Score=170.27 Aligned_cols=198 Identities=16% Similarity=0.285 Sum_probs=159.6
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW 152 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~ 152 (350)
....|.||++. |.|+.| +.+.|++|+.|.+|+|||+++ ++.+..+ .+|...|..+.|
T Consensus 229 c~~~L~GHtGS------------------VLCLqy--d~rviisGSSDsTvrvWDv~t--ge~l~tl-ihHceaVLhlrf 285 (499)
T KOG0281|consen 229 CLKILTGHTGS------------------VLCLQY--DERVIVSGSSDSTVRVWDVNT--GEPLNTL-IHHCEAVLHLRF 285 (499)
T ss_pred HHHhhhcCCCc------------------EEeeec--cceEEEecCCCceEEEEeccC--CchhhHH-hhhcceeEEEEE
Confidence 35777888777 666666 456999999999999999964 7776666 479999999999
Q ss_pred eeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe
Q 018806 153 RPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY 232 (350)
Q Consensus 153 sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~ 232 (350)
+. +.+++++.|.++.+||+..+... .+...+.||. ..|..+.|+ .++|++++.
T Consensus 286 ~n--g~mvtcSkDrsiaVWdm~sps~i----------------------t~rrVLvGHr-AaVNvVdfd--~kyIVsASg 338 (499)
T KOG0281|consen 286 SN--GYMVTCSKDRSIAVWDMASPTDI----------------------TLRRVLVGHR-AAVNVVDFD--DKYIVSASG 338 (499)
T ss_pred eC--CEEEEecCCceeEEEeccCchHH----------------------HHHHHHhhhh-hheeeeccc--cceEEEecC
Confidence 84 58999999999999999854421 1234578886 799999985 569999999
Q ss_pred CCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEE
Q 018806 233 ESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMI 310 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l 310 (350)
|. +|++|++.+++... +.+|..+|-|+.+ .|+++++|+.|.+|++||+..|++. .+.+|+.-|.++.|. .+.+
T Consensus 339 DR-TikvW~~st~efvRtl~gHkRGIAClQY--r~rlvVSGSSDntIRlwdi~~G~cLRvLeGHEeLvRciRFd--~krI 413 (499)
T KOG0281|consen 339 DR-TIKVWSTSTCEFVRTLNGHKRGIACLQY--RDRLVVSGSSDNTIRLWDIECGACLRVLEGHEELVRCIRFD--NKRI 413 (499)
T ss_pred Cc-eEEEEeccceeeehhhhcccccceehhc--cCeEEEecCCCceEEEEeccccHHHHHHhchHHhhhheeec--Ccee
Confidence 95 99999999998876 5568889988877 6899999999999999999999984 577999999999996 5677
Q ss_pred EEEE-CCCeEEEEEEe
Q 018806 311 LLAF-AGSLTLGSIHF 325 (350)
Q Consensus 311 ~~~~-~~~~~~~~~~~ 325 (350)
++|. ++.+.+|.+..
T Consensus 414 VSGaYDGkikvWdl~a 429 (499)
T KOG0281|consen 414 VSGAYDGKIKVWDLQA 429 (499)
T ss_pred eeccccceEEEEeccc
Confidence 7775 55555554443
No 67
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.90 E-value=9.7e-23 Score=168.38 Aligned_cols=210 Identities=19% Similarity=0.271 Sum_probs=163.3
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|+++.|.++++++++++.|+.+++|+++. .+...++ .+|.+.|+++.|.-....+++++.|.++++||+....+..
T Consensus 221 ~it~~d~d~~~~~~iAas~d~~~r~Wnvd~--~r~~~TL-sGHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~~C~k 297 (459)
T KOG0288|consen 221 NITSIDFDSDNKHVIAASNDKNLRLWNVDS--LRLRHTL-SGHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKAYCSK 297 (459)
T ss_pred CcceeeecCCCceEEeecCCCceeeeeccc--hhhhhhh-cccccceeeehhhccccceeeccccchhhhhhhhhhheec
Confidence 699999999999999999999999999964 5555555 4799999999998775557888889999999999766665
Q ss_pred eeeccccccc------ceecCCCCCceEEeeeccC------CCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce
Q 018806 181 SVRSGAASFL------GALSRGPGTRWTLVDFLRS------QNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT 248 (350)
Q Consensus 181 ~~~~~~~~~~------~~~~~~~~~~~~~~~~~~~------~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~ 248 (350)
.+..+..... ..++.-.+.+++.|+.-.+ .-.+.|+++..+++|..|.+++.|+ ++.+.|+++.+..
T Consensus 298 t~l~~S~cnDI~~~~~~~~SgH~DkkvRfwD~Rs~~~~~sv~~gg~vtSl~ls~~g~~lLsssRDd-tl~viDlRt~eI~ 376 (459)
T KOG0288|consen 298 TVLPGSQCNDIVCSISDVISGHFDKKVRFWDIRSADKTRSVPLGGRVTSLDLSMDGLELLSSSRDD-TLKVIDLRTKEIR 376 (459)
T ss_pred cccccccccceEecceeeeecccccceEEEeccCCceeeEeecCcceeeEeeccCCeEEeeecCCC-ceeeeecccccEE
Confidence 5554432211 1133334556666652111 1136899999999999999999996 9999999998766
Q ss_pred eeeec-----CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cc--cCCCCeEEEEEcCCCCEEEEEE
Q 018806 249 PIRRG-----FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WS--STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 249 ~~~~~-----~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~--~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
..... ....+.++|||++.|+++|+.||.|+||++.++++.. +. .....|++++|+|.|..|+.+.
T Consensus 377 ~~~sA~g~k~asDwtrvvfSpd~~YvaAGS~dgsv~iW~v~tgKlE~~l~~s~s~~aI~s~~W~~sG~~Llsad 450 (459)
T KOG0288|consen 377 QTFSAEGFKCASDWTRVVFSPDGSYVAAGSADGSVYIWSVFTGKLEKVLSLSTSNAAITSLSWNPSGSGLLSAD 450 (459)
T ss_pred EEeeccccccccccceeEECCCCceeeeccCCCcEEEEEccCceEEEEeccCCCCcceEEEEEcCCCchhhccc
Confidence 54432 2347889999999999999999999999999999843 33 2223699999999999999775
No 68
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.90 E-value=4.7e-23 Score=182.46 Aligned_cols=220 Identities=17% Similarity=0.245 Sum_probs=160.7
Q ss_pred CeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEE-EEecCCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSL-SVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~-~~~~d~~v~iwd~~~~~~ 178 (350)
.+..|.|+. +.++||+++..|.|.+||+...........+..|...++++.|++....++ +++.||+|++||++....
T Consensus 89 S~~DVkW~~~~~NlIAT~s~nG~i~vWdlnk~~rnk~l~~f~EH~Rs~~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S 168 (839)
T KOG0269|consen 89 SAADVKWGQLYSNLIATCSTNGVISVWDLNKSIRNKLLTVFNEHERSANKLDFHSTEPNILISGSQDGTVKCWDLRSKKS 168 (839)
T ss_pred ehhhcccccchhhhheeecCCCcEEEEecCccccchhhhHhhhhccceeeeeeccCCccEEEecCCCceEEEEeeecccc
Confidence 466778874 458999999999999999974322333334468999999999998755554 555599999999995544
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--eeeeecCCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG--TPIRRGFGG 256 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~~~ 256 (350)
... +.+.. ..|.+++|+|.....+++..|+|.+.+||++.... ..+..|.++
T Consensus 169 ~~t-------------------------~~~nS-ESiRDV~fsp~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~Gp 222 (839)
T KOG0269|consen 169 KST-------------------------FRSNS-ESIRDVKFSPGYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNGP 222 (839)
T ss_pred ccc-------------------------ccccc-hhhhceeeccCCCceEEEecCCceEEEeeccCchhHHHHhhcccCc
Confidence 333 33333 68999999996444444445558999999997754 345679999
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee--ccccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCCC--CC
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE--PWSSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHFASK--PP 330 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~--~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~~--~~ 330 (350)
|.++.|+|++.+||+|+.|+.|+|||+.+.+.. .......++..+.|-|+.++.+..| -++..|..|++... |.
T Consensus 223 V~c~nwhPnr~~lATGGRDK~vkiWd~t~~~~~~~~tInTiapv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvrRPYIP~ 302 (839)
T KOG0269|consen 223 VLCLNWHPNREWLATGGRDKMVKIWDMTDSRAKPKHTINTIAPVGRVKWRPARSYHLATCSMVVDTSVHVWDVRRPYIPY 302 (839)
T ss_pred eEEEeecCCCceeeecCCCccEEEEeccCCCccceeEEeecceeeeeeeccCccchhhhhhccccceEEEEeeccccccc
Confidence 999999999999999999999999999877663 3345677899999999988755444 33444445544432 22
Q ss_pred -CCceeecccccceeec
Q 018806 331 -SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 331 -~~~~~~~~v~~~~~~~ 346 (350)
++..|...++...+.+
T Consensus 303 ~t~~eH~~~vt~i~W~~ 319 (839)
T KOG0269|consen 303 ATFLEHTDSVTGIAWDS 319 (839)
T ss_pred eeeeccCccccceeccC
Confidence 6667777776665543
No 69
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.90 E-value=5.7e-22 Score=162.27 Aligned_cols=190 Identities=20% Similarity=0.349 Sum_probs=153.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCC----------------------CCceeEecCCCCCCeeEEEEeeCCCe
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSE----------------------GKDACILTSDSQRDVKVLEWRPNGGR 158 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~----------------------~~~~~~~~~~~~~~v~~~~~sp~~~~ 158 (350)
.|.+|+..++|..+++|+.|.++.||+..... .+.+.....+|..+|.++.|++. ..
T Consensus 195 ~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d~-~v 273 (423)
T KOG0313|consen 195 SVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSDA-TV 273 (423)
T ss_pred ceeEEEecCCCCeEEeecccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcCC-Cc
Confidence 49999999999999999999999999932100 01122344589999999999985 78
Q ss_pred EEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEE
Q 018806 159 SLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFT 238 (350)
Q Consensus 159 l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~ 238 (350)
+++++.|.+|+.||+..++....+... ....++..+|..+.|++++.|. .|+
T Consensus 274 ~yS~SwDHTIk~WDletg~~~~~~~~~---------------------------ksl~~i~~~~~~~Ll~~gssdr-~ir 325 (423)
T KOG0313|consen 274 IYSVSWDHTIKVWDLETGGLKSTLTTN---------------------------KSLNCISYSPLSKLLASGSSDR-HIR 325 (423)
T ss_pred eEeecccceEEEEEeecccceeeeecC---------------------------cceeEeecccccceeeecCCCC-cee
Confidence 888999999999999977765443332 5889999999999999999995 999
Q ss_pred EEeCCCCCc----eeeeecCCCeEEEEEcCCCCE-EEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEE
Q 018806 239 IWDVAQGLG----TPIRRGFGGLSILKWSPTGDY-FFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMIL 311 (350)
Q Consensus 239 iwd~~~~~~----~~~~~~~~~v~~~~~sp~g~~-l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~ 311 (350)
+||-+++.. ..+.+|...|.++.|+|...+ |++++.|+++++||+++.+. ..+.+|...|.++.|+. +..|+
T Consensus 326 l~DPR~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~~S~S~D~t~klWDvRS~k~plydI~~h~DKvl~vdW~~-~~~Iv 404 (423)
T KOG0313|consen 326 LWDPRTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQLVSGSYDNTVKLWDVRSTKAPLYDIAGHNDKVLSVDWNE-GGLIV 404 (423)
T ss_pred ecCCCCCCCceeEEeeecchhhhhheecCCCCceEEEEEecCCeEEEEEeccCCCcceeeccCCceEEEEeccC-CceEE
Confidence 999998753 346678999999999997655 68999999999999998773 56778999999999986 66777
Q ss_pred EEE-CCCeEE
Q 018806 312 LAF-AGSLTL 320 (350)
Q Consensus 312 ~~~-~~~~~~ 320 (350)
+|+ |+.+++
T Consensus 405 SGGaD~~l~i 414 (423)
T KOG0313|consen 405 SGGADNKLRI 414 (423)
T ss_pred eccCcceEEE
Confidence 775 444433
No 70
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.90 E-value=1e-21 Score=180.32 Aligned_cols=227 Identities=18% Similarity=0.258 Sum_probs=141.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCC--C---CC----------ceeEecCCCCCCeeEEEEeeCCCeEEEEe
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS--E---GK----------DACILTSDSQRDVKVLEWRPNGGRSLSVG 163 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~--~---~~----------~~~~~~~~~~~~v~~~~~sp~~~~l~~~~ 163 (350)
...|+|+.|+|||++||+|+.|+.|.||..... . +. .......+|...|..++|+|++..+++++
T Consensus 69 ~~sv~CVR~S~dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~DV~Dv~Wsp~~~~lvS~s 148 (942)
T KOG0973|consen 69 DGSVNCVRFSPDGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRGHDSDVLDVNWSPDDSLLVSVS 148 (942)
T ss_pred cCceeEEEECCCCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEecCCCccceeccCCCccEEEEec
Confidence 345999999999999999999999999998620 0 00 12233458999999999999988888899
Q ss_pred cCCcEEEEecCCCCCCceeecccccccceecCCC----------CCceEEeeecc--------CCC-----CCceeeEEE
Q 018806 164 CKGGICIWAPSYPGNAASVRSGAASFLGALSRGP----------GTRWTLVDFLR--------SQN-----GEQITALSW 220 (350)
Q Consensus 164 ~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~----------~~~~~~~~~~~--------~~~-----~~~v~~~~~ 220 (350)
-|++|.||+..+.+.. .+..++.+.+..+++++ |..+.+|++.. ++. ......+.|
T Consensus 149 ~DnsViiwn~~tF~~~-~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~~~~~T~f~RlSW 227 (942)
T KOG0973|consen 149 LDNSVIIWNAKTFELL-KVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEESPLTTFFLRLSW 227 (942)
T ss_pred ccceEEEEccccceee-eeeecccccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhhCCCcceeeeccc
Confidence 9999999999844222 11112112222211111 12222333111 000 012233444
Q ss_pred CCCCCeEEEEEeCC---CeEEEEeCCCCC-ceeeeecCCCeEEEEEcCC-----CC------------EEEEEecCCeEE
Q 018806 221 GPDGRYLASASYES---SSFTIWDVAQGL-GTPIRRGFGGLSILKWSPT-----GD------------YFFAAKFDGTFY 279 (350)
Q Consensus 221 sp~g~~l~~~~~d~---g~i~iwd~~~~~-~~~~~~~~~~v~~~~~sp~-----g~------------~l~~~~~d~~v~ 279 (350)
||||++|++...-+ -++.|.+-.+-+ ...+.+|.+++.+++|+|. .+ .+|+|+.|++|.
T Consensus 228 SPDG~~las~nA~n~~~~~~~IieR~tWk~~~~LvGH~~p~evvrFnP~lfe~~~~ng~~~~~~~~y~i~AvgSqDrSlS 307 (942)
T KOG0973|consen 228 SPDGHHLASPNAVNGGKSTIAIIERGTWKVDKDLVGHSAPVEVVRFNPKLFERNNKNGTSTQPNCYYCIAAVGSQDRSLS 307 (942)
T ss_pred CCCcCeecchhhccCCcceeEEEecCCceeeeeeecCCCceEEEEeChHHhccccccCCccCCCcceEEEEEecCCccEE
Confidence 44444444432110 134444433323 2346678899999999971 11 568999999999
Q ss_pred EEeCCCCceec--cccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 280 LWETNTWTSEP--WSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 280 iwd~~~~~~~~--~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
||.....+..- ..-....|.+++|+|||..|++++ .++.+..+++..
T Consensus 308 VW~T~~~RPl~vi~~lf~~SI~DmsWspdG~~LfacS-~DGtV~~i~Fee 356 (942)
T KOG0973|consen 308 VWNTALPRPLFVIHNLFNKSIVDMSWSPDGFSLFACS-LDGTVALIHFEE 356 (942)
T ss_pred EEecCCCCchhhhhhhhcCceeeeeEcCCCCeEEEEe-cCCeEEEEEcch
Confidence 99986655522 113456899999999999998665 334667777664
No 71
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.90 E-value=4.2e-22 Score=166.59 Aligned_cols=200 Identities=17% Similarity=0.313 Sum_probs=151.4
Q ss_pred eeEEEEecCC-CEEEEEECCCeEEEEEccCCCC----CceeEecCCCCCCeeEEEEeeCCCeEEE-EecCCcEEEEecCC
Q 018806 102 LQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEG----KDACILTSDSQRDVKVLEWRPNGGRSLS-VGCKGGICIWAPSY 175 (350)
Q Consensus 102 V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~----~~~~~~~~~~~~~v~~~~~sp~~~~l~~-~~~d~~v~iwd~~~ 175 (350)
=++++|++.. -.|++++.|++|++||+..... ......+.+|...|..++|++-...+++ ++.|+.+.|||++.
T Consensus 180 g~glsWn~~~~g~Lls~~~d~~i~lwdi~~~~~~~~~~~p~~~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~ 259 (422)
T KOG0264|consen 180 GYGLSWNRQQEGTLLSGSDDHTICLWDINAESKEDKVVDPKTIFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDTRS 259 (422)
T ss_pred ccccccccccceeEeeccCCCcEEEEeccccccCCccccceEEeecCCcceehhhccccchhhheeecCCCeEEEEEcCC
Confidence 5668999865 5788999999999999975433 2334555689999999999997665555 55579999999995
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc--eeeee
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLG--TPIRR 252 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~ 252 (350)
. ... ......+|. +.+.+++|+|- +..||+++.| ++|++||++.... ..+..
T Consensus 260 ~--~~~---------------------~~~~~~ah~-~~vn~~~fnp~~~~ilAT~S~D-~tV~LwDlRnL~~~lh~~e~ 314 (422)
T KOG0264|consen 260 N--TSK---------------------PSHSVKAHS-AEVNCVAFNPFNEFILATGSAD-KTVALWDLRNLNKPLHTFEG 314 (422)
T ss_pred C--CCC---------------------CcccccccC-CceeEEEeCCCCCceEEeccCC-CcEEEeechhcccCceeccC
Confidence 2 111 112245665 79999999995 5567788889 6999999998654 34567
Q ss_pred cCCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCceec------------c---ccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 253 GFGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTSEP------------W---SSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 253 ~~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~~~------------~---~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
|...|.++.|+|. ...||+++.|+.+.|||+..-...+ + -+|...|..+.|+|+..+++++...
T Consensus 315 H~dev~~V~WSPh~etvLASSg~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgGH~~kV~DfsWnp~ePW~I~Svae 394 (422)
T KOG0264|consen 315 HEDEVFQVEWSPHNETVLASSGTDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGGHTAKVSDFSWNPNEPWTIASVAE 394 (422)
T ss_pred CCcceEEEEeCCCCCceeEecccCCcEEEEeccccccccChhhhccCCcceeEEecCcccccccccCCCCCCeEEEEecC
Confidence 8899999999996 4567889999999999996422211 1 2788899999999999999988766
Q ss_pred CeEEEEEEeC
Q 018806 317 SLTLGSIHFA 326 (350)
Q Consensus 317 ~~~~~~~~~~ 326 (350)
+..+..|++.
T Consensus 395 DN~LqIW~~s 404 (422)
T KOG0264|consen 395 DNILQIWQMA 404 (422)
T ss_pred CceEEEeecc
Confidence 6666666654
No 72
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.90 E-value=5.9e-22 Score=175.05 Aligned_cols=225 Identities=10% Similarity=0.108 Sum_probs=166.9
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.+.+..|-|.++++++|...|.+.++|+.. ... ......|++.|++++.+||+..+++++.|.+|++||+......
T Consensus 414 y~l~~~Fvpgd~~Iv~G~k~Gel~vfdlaS--~~l-~Eti~AHdgaIWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~- 489 (888)
T KOG0306|consen 414 YILASKFVPGDRYIVLGTKNGELQVFDLAS--ASL-VETIRAHDGAIWSISLSPDNKGFVTGSADKTVKFWDFKLVVSV- 489 (888)
T ss_pred cEEEEEecCCCceEEEeccCCceEEEEeeh--hhh-hhhhhccccceeeeeecCCCCceEEecCCcEEEEEeEEEEecc-
Confidence 356667777777777777777777777753 332 3333479999999999999999999999999999998722110
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeeeecCCCeEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIRRGFGGLSI 259 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~~~~~~v~~ 259 (350)
.++.... + .+...+++.- ...|.++++||||++|+.+-.|+ +|++|-+++-+. ..+.+|.-+|.|
T Consensus 490 ---~gt~~k~--l------sl~~~rtLel--~ddvL~v~~Spdgk~LaVsLLdn-TVkVyflDtlKFflsLYGHkLPV~s 555 (888)
T KOG0306|consen 490 ---PGTQKKV--L------SLKHTRTLEL--EDDVLCVSVSPDGKLLAVSLLDN-TVKVYFLDTLKFFLSLYGHKLPVLS 555 (888)
T ss_pred ---Cccccee--e------eeccceEEec--cccEEEEEEcCCCcEEEEEeccC-eEEEEEecceeeeeeecccccceeE
Confidence 0000000 0 0001122222 25899999999999999999996 999999998765 457889999999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe--CCCCCCCceee
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHF--ASKPPSLDAHL 336 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~--~~~~~~~~~~~ 336 (350)
+..|||++.+++|+.|++|+||-++-|.+ +.+.+|...|.++.|-|+..++. +++++..+..|+- ...-..+.+|.
T Consensus 556 mDIS~DSklivTgSADKnVKiWGLdFGDCHKS~fAHdDSvm~V~F~P~~~~FF-t~gKD~kvKqWDg~kFe~iq~L~~H~ 634 (888)
T KOG0306|consen 556 MDISPDSKLIVTGSADKNVKIWGLDFGDCHKSFFAHDDSVMSVQFLPKTHLFF-TCGKDGKVKQWDGEKFEEIQKLDGHH 634 (888)
T ss_pred EeccCCcCeEEeccCCCceEEeccccchhhhhhhcccCceeEEEEcccceeEE-EecCcceEEeechhhhhhheeeccch
Confidence 99999999999999999999999999999 56889999999999999665555 5544445555532 23344778888
Q ss_pred ccccccee
Q 018806 337 LPVDLPDI 344 (350)
Q Consensus 337 ~~v~~~~~ 344 (350)
..|.....
T Consensus 635 ~ev~cLav 642 (888)
T KOG0306|consen 635 SEVWCLAV 642 (888)
T ss_pred heeeeeEE
Confidence 87766544
No 73
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.89 E-value=2.1e-22 Score=161.93 Aligned_cols=210 Identities=16% Similarity=0.165 Sum_probs=168.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|.|+.||.|...||+|+.||.|++|.+.+ |.++..+...|...|+++.|+.|+.++++++.|.+++|.-+..++.
T Consensus 265 aVlci~FSRDsEMlAsGsqDGkIKvWri~t--G~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSGK~-- 340 (508)
T KOG0275|consen 265 AVLCISFSRDSEMLASGSQDGKIKVWRIET--GQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSGKC-- 340 (508)
T ss_pred ceEEEeecccHHHhhccCcCCcEEEEEEec--chHHHHhhhhhccCeeEEEEccCcchhhcccccceEEEeccccchh--
Confidence 799999999999999999999999999954 8888888778999999999999999999999999999998874443
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee---cCCCe
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR---GFGGL 257 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~---~~~~v 257 (350)
.+.+++|. +.|+...|++||.++++++.| |+|++|+.++.++...+. .+.+|
T Consensus 341 -----------------------LKEfrGHs-Syvn~a~ft~dG~~iisaSsD-gtvkvW~~KtteC~~Tfk~~~~d~~v 395 (508)
T KOG0275|consen 341 -----------------------LKEFRGHS-SYVNEATFTDDGHHIISASSD-GTVKVWHGKTTECLSTFKPLGTDYPV 395 (508)
T ss_pred -----------------------HHHhcCcc-ccccceEEcCCCCeEEEecCC-ccEEEecCcchhhhhhccCCCCcccc
Confidence 45578887 799999999999999999999 799999999998865443 34567
Q ss_pred EEEEEcC-CCCEEEEEecCCeEEEEeCCCCceeccc---cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC--CCC
Q 018806 258 SILKWSP-TGDYFFAAKFDGTFYLWETNTWTSEPWS---STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK--PPS 331 (350)
Q Consensus 258 ~~~~~sp-~g~~l~~~~~d~~v~iwd~~~~~~~~~~---~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~--~~~ 331 (350)
.++-.-| +-..++++...++|+|.++...-.+.+. ...+...++..||.|.++++.+.+ ..+|.+.+.+. ..+
T Consensus 396 nsv~~~PKnpeh~iVCNrsntv~imn~qGQvVrsfsSGkREgGdFi~~~lSpkGewiYcigED-~vlYCF~~~sG~LE~t 474 (508)
T KOG0275|consen 396 NSVILLPKNPEHFIVCNRSNTVYIMNMQGQVVRSFSSGKREGGDFINAILSPKGEWIYCIGED-GVLYCFSVLSGKLERT 474 (508)
T ss_pred eeEEEcCCCCceEEEEcCCCeEEEEeccceEEeeeccCCccCCceEEEEecCCCcEEEEEccC-cEEEEEEeecCceeee
Confidence 7777666 4567888999999999999765444443 234556778899999999876533 34566655433 335
Q ss_pred Cceeecccc
Q 018806 332 LDAHLLPVD 340 (350)
Q Consensus 332 ~~~~~~~v~ 340 (350)
+..|..-+-
T Consensus 475 l~VhEkdvI 483 (508)
T KOG0275|consen 475 LPVHEKDVI 483 (508)
T ss_pred eeccccccc
Confidence 566655443
No 74
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=6.9e-22 Score=166.64 Aligned_cols=192 Identities=15% Similarity=0.143 Sum_probs=158.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~~ 179 (350)
.|+++.|-.||++||.|...|.|+|+|.. .+.+......|..+|..+.|+|+++.+++.++| +.+++||+....
T Consensus 70 ~v~s~~fR~DG~LlaaGD~sG~V~vfD~k---~r~iLR~~~ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~-- 144 (487)
T KOG0310|consen 70 VVYSVDFRSDGRLLAAGDESGHVKVFDMK---SRVILRQLYAHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAY-- 144 (487)
T ss_pred ceeEEEeecCCeEEEccCCcCcEEEeccc---cHHHHHHHhhccCceeEEEecccCCeEEEecCCCceEEEEEcCCcE--
Confidence 48999999999999999999999999963 233344446899999999999998888887775 888999998322
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCC-CceeeeecCCCe
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVAQG-LGTPIRRGFGGL 257 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~-~~~~~~~~~~~v 257 (350)
..-.+.+|. ..|.+.+|+|-. ..+++|+.| |+|++||++.. .......|..+|
T Consensus 145 -----------------------v~~~l~~ht-DYVR~g~~~~~~~hivvtGsYD-g~vrl~DtR~~~~~v~elnhg~pV 199 (487)
T KOG0310|consen 145 -----------------------VQAELSGHT-DYVRCGDISPANDHIVVTGSYD-GKVRLWDTRSLTSRVVELNHGCPV 199 (487)
T ss_pred -----------------------EEEEecCCc-ceeEeeccccCCCeEEEecCCC-ceEEEEEeccCCceeEEecCCCce
Confidence 123477887 599999999964 477889999 79999999987 445566788999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-ec-cccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EP-WSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~-~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
..+.+-|.|..|++++ ...|+|||+-+|.. .. ...|...|+|+.+..++..|++++ |+...++..
T Consensus 200 e~vl~lpsgs~iasAg-Gn~vkVWDl~~G~qll~~~~~H~KtVTcL~l~s~~~rLlS~sLD~~VKVfd~ 267 (487)
T KOG0310|consen 200 ESVLALPSGSLIASAG-GNSVKVWDLTTGGQLLTSMFNHNKTVTCLRLASDSTRLLSGSLDRHVKVFDT 267 (487)
T ss_pred eeEEEcCCCCEEEEcC-CCeEEEEEecCCceehhhhhcccceEEEEEeecCCceEeecccccceEEEEc
Confidence 9999999999999887 56799999996655 33 445999999999999999999988 777777773
No 75
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.89 E-value=7.3e-22 Score=157.14 Aligned_cols=214 Identities=15% Similarity=0.174 Sum_probs=144.9
Q ss_pred ccCeeEEEEecC-CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 99 EVDLQGVSWHQH-KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 99 ~~~V~~v~~sp~-g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
+..|.+++|||. ..+++.+|.|++||+|++... +.........|.++|.+++|+.||..+++++.|+.+++||+..++
T Consensus 27 ~DsIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~-g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~S~Q 105 (347)
T KOG0647|consen 27 EDSISALAFSPQADNLLAAGSWDGTVRIWEVQNS-GQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLASGQ 105 (347)
T ss_pred ccchheeEeccccCceEEecccCCceEEEEEecC-CcccchhhhccCCCeEEEEEccCCceEEeeccCCceEEEEccCCC
Confidence 446999999994 456668899999999999743 444444445799999999999999999999999999999999553
Q ss_pred CCceeec-------ccccccce----ecCCCCCceEEeeeccCC------------------------------------
Q 018806 178 NAASVRS-------GAASFLGA----LSRGPGTRWTLVDFLRSQ------------------------------------ 210 (350)
Q Consensus 178 ~~~~~~~-------~~~~~~~~----~~~~~~~~~~~~~~~~~~------------------------------------ 210 (350)
...+.. ..+..-.. ...+.|..++.|++-...
T Consensus 106 -~~~v~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vVata~r~i~vynL~ 184 (347)
T KOG0647|consen 106 -VSQVAAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVVATAERHIAVYNLE 184 (347)
T ss_pred -eeeeeecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEEEecCCcEEEEEcC
Confidence 222211 11111111 223344455555521100
Q ss_pred ------------CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc---eeeeecC---------CCeEEEEEcCCC
Q 018806 211 ------------NGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG---TPIRRGF---------GGLSILKWSPTG 266 (350)
Q Consensus 211 ------------~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~---~~~~~~~---------~~v~~~~~sp~g 266 (350)
..-.+++++..+|.+..+.|+-+ |.+.+..++.+.. ..+..|. ..|.+++|+|.-
T Consensus 185 n~~te~k~~~SpLk~Q~R~va~f~d~~~~alGsiE-Grv~iq~id~~~~~~nFtFkCHR~~~~~~~~VYaVNsi~FhP~h 263 (347)
T KOG0647|consen 185 NPPTEFKRIESPLKWQTRCVACFQDKDGFALGSIE-GRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDVYAVNSIAFHPVH 263 (347)
T ss_pred CCcchhhhhcCcccceeeEEEEEecCCceEeeeec-ceEEEEecCCCCccCceeEEEeccCCCCCCceEEecceEeeccc
Confidence 01123455555555555555555 4666665555311 1222232 247789999998
Q ss_pred CEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 267 DYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 267 ~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
..|++++.||++.+||-+.... .....|..+|++.+|+.+|.+++.+.+
T Consensus 264 gtlvTaGsDGtf~FWDkdar~kLk~s~~~~qpItcc~fn~~G~ifaYA~g 313 (347)
T KOG0647|consen 264 GTLVTAGSDGTFSFWDKDARTKLKTSETHPQPITCCSFNRNGSIFAYALG 313 (347)
T ss_pred ceEEEecCCceEEEecchhhhhhhccCcCCCccceeEecCCCCEEEEEee
Confidence 8999999999999999877655 455788999999999999999999853
No 76
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.89 E-value=1.6e-21 Score=164.45 Aligned_cols=188 Identities=13% Similarity=0.189 Sum_probs=151.0
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEE-EecCCcEEEEecCCC
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLS-VGCKGGICIWAPSYP 176 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~-~~~d~~v~iwd~~~~ 176 (350)
..+|..+.|+|++ +.+++|+.|+.+++||+++ ... .....+|...|.+.+|+|-..++++ ++.||+|++||++..
T Consensus 110 ~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~--a~v-~~~l~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~DtR~~ 186 (487)
T KOG0310|consen 110 QAPVHVTKFSPQDNTMLVSGSDDKVVKYWDLST--AYV-QAELSGHTDYVRCGDISPANDHIVVTGSYDGKVRLWDTRSL 186 (487)
T ss_pred cCceeEEEecccCCeEEEecCCCceEEEEEcCC--cEE-EEEecCCcceeEeeccccCCCeEEEecCCCceEEEEEeccC
Confidence 4569999999865 6777888999999999964 332 3333589999999999998675555 555999999999854
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-ee-eeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TP-IRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~-~~~~~ 254 (350)
.. .. .++ . ++.+|..+.+-|.|..|++++.. .|++||+-+|.. .. +..|.
T Consensus 187 ~~-~v-----------------------~el-n-hg~pVe~vl~lpsgs~iasAgGn--~vkVWDl~~G~qll~~~~~H~ 238 (487)
T KOG0310|consen 187 TS-RV-----------------------VEL-N-HGCPVESVLALPSGSLIASAGGN--SVKVWDLTTGGQLLTSMFNHN 238 (487)
T ss_pred Cc-ee-----------------------EEe-c-CCCceeeEEEcCCCCEEEEcCCC--eEEEEEecCCceehhhhhccc
Confidence 31 11 111 1 24699999999999999999876 799999996644 33 33489
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
..|+|+++..++..|++++-|+.|++||+.+.+...-....++|.+++.+|+++.+++|..+.
T Consensus 239 KtVTcL~l~s~~~rLlS~sLD~~VKVfd~t~~Kvv~s~~~~~pvLsiavs~dd~t~viGmsnG 301 (487)
T KOG0310|consen 239 KTVTCLRLASDSTRLLSGSLDRHVKVFDTTNYKVVHSWKYPGPVLSIAVSPDDQTVVIGMSNG 301 (487)
T ss_pred ceEEEEEeecCCceEeecccccceEEEEccceEEEEeeecccceeeEEecCCCceEEEecccc
Confidence 999999999999999999999999999998888876667788999999999999999986444
No 77
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.89 E-value=3.5e-22 Score=162.39 Aligned_cols=191 Identities=16% Similarity=0.219 Sum_probs=159.1
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
|..+++|+--.||.+++.|+.|+.||++. .+.+..+ .+|-..|.+++.+|.-..+++++.|.+++|||++....
T Consensus 196 vr~vavS~rHpYlFs~gedk~VKCwDLe~--nkvIR~Y-hGHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr~~--- 269 (460)
T KOG0285|consen 196 VRGVAVSKRHPYLFSAGEDKQVKCWDLEY--NKVIRHY-HGHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTRAS--- 269 (460)
T ss_pred eeeeeecccCceEEEecCCCeeEEEechh--hhhHHHh-ccccceeEEEeccccceeEEecCCcceEEEeeecccce---
Confidence 89999999999999999999999999964 4444444 58999999999999988999999999999999995433
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEE
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSIL 260 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~ 260 (350)
+..+.||. ..|.++.+.|-...+++++.| ++|++||++.++... +..|+..+.++
T Consensus 270 ----------------------V~~l~GH~-~~V~~V~~~~~dpqvit~S~D-~tvrlWDl~agkt~~tlt~hkksvral 325 (460)
T KOG0285|consen 270 ----------------------VHVLSGHT-NPVASVMCQPTDPQVITGSHD-STVRLWDLRAGKTMITLTHHKKSVRAL 325 (460)
T ss_pred ----------------------EEEecCCC-CcceeEEeecCCCceEEecCC-ceEEEeeeccCceeEeeecccceeeEE
Confidence 55688887 799999999988899999999 599999999998654 56678899999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECC-CeEEEEEE
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAG-SLTLGSIH 324 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~-~~~~~~~~ 324 (350)
+.+|....+|+++.|. |+-|++..+.. ..+.+|..-|..++...||-++. |+++ .+..|+|+
T Consensus 326 ~lhP~e~~fASas~dn-ik~w~~p~g~f~~nlsgh~~iintl~~nsD~v~~~-G~dng~~~fwdwk 389 (460)
T KOG0285|consen 326 CLHPKENLFASASPDN-IKQWKLPEGEFLQNLSGHNAIINTLSVNSDGVLVS-GGDNGSIMFWDWK 389 (460)
T ss_pred ecCCchhhhhccCCcc-ceeccCCccchhhccccccceeeeeeeccCceEEE-cCCceEEEEEecC
Confidence 9999998889888765 99999998887 45778999999999998875544 5544 34444443
No 78
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.89 E-value=2.2e-21 Score=161.41 Aligned_cols=194 Identities=15% Similarity=0.267 Sum_probs=162.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.+.++...|....+++|+.|..+.++|... ++ +..+..+|...|+.+.|+|+...+++++.|..|+||.......+.
T Consensus 221 gi~ald~~~s~~~ilTGG~d~~av~~d~~s--~q-~l~~~~Gh~kki~~v~~~~~~~~v~~aSad~~i~vws~~~~s~~~ 297 (506)
T KOG0289|consen 221 GITALDIIPSSSKILTGGEDKTAVLFDKPS--NQ-ILATLKGHTKKITSVKFHKDLDTVITASADEIIRVWSVPLSSEPT 297 (506)
T ss_pred CeeEEeecCCCCcceecCCCCceEEEecch--hh-hhhhccCcceEEEEEEeccchhheeecCCcceEEeeccccccCcc
Confidence 688888888878899999999999999753 33 344457999999999999997788888889999999988544322
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC---CCe
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF---GGL 257 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~---~~v 257 (350)
. ...| +++|+.+..+|.|.||++++.| |++.+.|++++.......+. -.+
T Consensus 298 ~-------------------------~~~h-~~~V~~ls~h~tgeYllsAs~d-~~w~Fsd~~~g~~lt~vs~~~s~v~~ 350 (506)
T KOG0289|consen 298 S-------------------------SRPH-EEPVTGLSLHPTGEYLLSASND-GTWAFSDISSGSQLTVVSDETSDVEY 350 (506)
T ss_pred c-------------------------cccc-cccceeeeeccCCcEEEEecCC-ceEEEEEccCCcEEEEEeecccccee
Confidence 2 3344 4799999999999999999999 69999999999877665553 458
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCC-eEEEEEE
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGS-LTLGSIH 324 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~-~~~~~~~ 324 (350)
++.+|+|||.++.+|..|+.|+|||+.++.. ..+.+|.++|..++|+.+|-||+++++++ +.+|+++
T Consensus 351 ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~a~Fpght~~vk~i~FsENGY~Lat~add~~V~lwDLR 419 (506)
T KOG0289|consen 351 TSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNVAKFPGHTGPVKAISFSENGYWLATAADDGSVKLWDLR 419 (506)
T ss_pred EEeeEcCCceEEeccCCCceEEEEEcCCccccccCCCCCCceeEEEeccCceEEEEEecCCeEEEEEeh
Confidence 8999999999999999999999999998876 56889999999999999999999999665 4444444
No 79
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.88 E-value=3e-21 Score=172.96 Aligned_cols=194 Identities=16% Similarity=0.189 Sum_probs=145.2
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEE-EecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLS-VGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~-~~~d~~v~iwd~~~~~~ 178 (350)
.+|.+++||.+ ++|++++.|+++++|++.. ..+++.+ .|..-|+|++|+|-+.+++. ++-|++++||++...+
T Consensus 370 ~DILDlSWSKn-~fLLSSSMDKTVRLWh~~~--~~CL~~F--~HndfVTcVaFnPvDDryFiSGSLD~KvRiWsI~d~~- 443 (712)
T KOG0283|consen 370 ADILDLSWSKN-NFLLSSSMDKTVRLWHPGR--KECLKVF--SHNDFVTCVAFNPVDDRYFISGSLDGKVRLWSISDKK- 443 (712)
T ss_pred hhheecccccC-CeeEeccccccEEeecCCC--cceeeEE--ecCCeeEEEEecccCCCcEeecccccceEEeecCcCe-
Confidence 35899999976 4788999999999999953 5555555 69999999999996555555 4559999999998322
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee---eeec--
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP---IRRG-- 253 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~---~~~~-- 253 (350)
+..|..+. .-|++++|+|||+..+.|+.+ |.+++|++...+... +..+
T Consensus 444 ----------------------Vv~W~Dl~----~lITAvcy~PdGk~avIGt~~-G~C~fY~t~~lk~~~~~~I~~~~~ 496 (712)
T KOG0283|consen 444 ----------------------VVDWNDLR----DLITAVCYSPDGKGAVIGTFN-GYCRFYDTEGLKLVSDFHIRLHNK 496 (712)
T ss_pred ----------------------eEeehhhh----hhheeEEeccCCceEEEEEec-cEEEEEEccCCeEEEeeeEeeccC
Confidence 11222222 589999999999999999999 899999998775432 1111
Q ss_pred ----CCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCce-eccccCC--CCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 254 ----FGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTS-EPWSSTS--GFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 254 ----~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~--~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
...|+.+.|.|.. ..|++.+.|..|+|||.++.+. ..+.++. ..=....|+.||++|++++ .+..+|.|++
T Consensus 497 Kk~~~~rITG~Q~~p~~~~~vLVTSnDSrIRI~d~~~~~lv~KfKG~~n~~SQ~~Asfs~Dgk~IVs~s-eDs~VYiW~~ 575 (712)
T KOG0283|consen 497 KKKQGKRITGLQFFPGDPDEVLVTSNDSRIRIYDGRDKDLVHKFKGFRNTSSQISASFSSDGKHIVSAS-EDSWVYIWKN 575 (712)
T ss_pred ccccCceeeeeEecCCCCCeEEEecCCCceEEEeccchhhhhhhcccccCCcceeeeEccCCCEEEEee-cCceEEEEeC
Confidence 2369999999743 3577778899999999987776 3444332 2235678999999999988 4457888887
Q ss_pred CC
Q 018806 326 AS 327 (350)
Q Consensus 326 ~~ 327 (350)
..
T Consensus 576 ~~ 577 (712)
T KOG0283|consen 576 DS 577 (712)
T ss_pred CC
Confidence 43
No 80
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.88 E-value=6.9e-21 Score=155.23 Aligned_cols=187 Identities=18% Similarity=0.237 Sum_probs=152.0
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
|...|.+++.+|+.+++|+|+.|....||+..+ +.....+ .+|+..|+++.|+.+|..|++++.+|.|+||+..++.
T Consensus 63 H~~svFavsl~P~~~l~aTGGgDD~AflW~~~~--ge~~~el-tgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~stg~ 139 (399)
T KOG0296|consen 63 HTDSVFAVSLHPNNNLVATGGGDDLAFLWDIST--GEFAGEL-TGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKVSTGG 139 (399)
T ss_pred cCCceEEEEeCCCCceEEecCCCceEEEEEccC--CcceeEe-cCCCCceEEEEEccCceEEEecCCCccEEEEEcccCc
Confidence 456899999999999999999999999999964 6666666 4899999999999998888888889999999998655
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-CceeeeecCCC
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-LGTPIRRGFGG 256 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-~~~~~~~~~~~ 256 (350)
....+. .. ...+.-+.|+|.+..|++++.| |.+.+|.+.++ .+..+.+|..+
T Consensus 140 ~~~~~~-------------------------~e-~~dieWl~WHp~a~illAG~~D-GsvWmw~ip~~~~~kv~~Gh~~~ 192 (399)
T KOG0296|consen 140 EQWKLD-------------------------QE-VEDIEWLKWHPRAHILLAGSTD-GSVWMWQIPSQALCKVMSGHNSP 192 (399)
T ss_pred eEEEee-------------------------cc-cCceEEEEecccccEEEeecCC-CcEEEEECCCcceeeEecCCCCC
Confidence 433322 11 2578889999999999999999 79999999984 45556778899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cc-cCCCCeEEEEEcCCCCEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WS-STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~-~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+++=.|.|+|+.++++..||+|++||.+++...- +. .......++.++..+..++.|.
T Consensus 193 ct~G~f~pdGKr~~tgy~dgti~~Wn~ktg~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~ 252 (399)
T KOG0296|consen 193 CTCGEFIPDGKRILTGYDDGTIIVWNPKTGQPLHKITQAEGLELPCISLNLAGSTLTKGN 252 (399)
T ss_pred cccccccCCCceEEEEecCceEEEEecCCCceeEEecccccCcCCccccccccceeEecc
Confidence 9999999999999999999999999999998732 22 2234456667777766665553
No 81
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.88 E-value=1.4e-21 Score=172.63 Aligned_cols=200 Identities=14% Similarity=0.195 Sum_probs=164.7
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCC---CCceeEec------CCCCCCeeEEEEeeCCCeEEEEecCCc
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSE---GKDACILT------SDSQRDVKVLEWRPNGGRSLSVGCKGG 167 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~---~~~~~~~~------~~~~~~v~~~~~sp~~~~l~~~~~d~~ 167 (350)
.|...+++++.+||++.+++|+.|.+|++|++..-. +.....+. ..-...|.++++||||+.++++--|++
T Consensus 452 AHdgaIWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnT 531 (888)
T KOG0306|consen 452 AHDGAIWSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNT 531 (888)
T ss_pred ccccceeeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCe
Confidence 345679999999999999999999999999975311 11111111 123567999999999877777777999
Q ss_pred EEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc
Q 018806 168 ICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG 247 (350)
Q Consensus 168 v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~ 247 (350)
|+||-++ .++..-.+.||. -+|.++..|||++.+++++.|. +|++|-++=|.+
T Consensus 532 VkVyflD-------------------------tlKFflsLYGHk-LPV~smDIS~DSklivTgSADK-nVKiWGLdFGDC 584 (888)
T KOG0306|consen 532 VKVYFLD-------------------------TLKFFLSLYGHK-LPVLSMDISPDSKLIVTGSADK-NVKIWGLDFGDC 584 (888)
T ss_pred EEEEEec-------------------------ceeeeeeecccc-cceeEEeccCCcCeEEeccCCC-ceEEeccccchh
Confidence 9999988 334455688997 6999999999999999999996 999999998887
Q ss_pred ee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 248 TP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 248 ~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.. ++.|+..|.++.|.|+...+++++.|+.|+-||-+..+. +.+.+|...|++++.+|+|.++++++ .+..+++
T Consensus 585 HKS~fAHdDSvm~V~F~P~~~~FFt~gKD~kvKqWDg~kFe~iq~L~~H~~ev~cLav~~~G~~vvs~s----hD~sIRl 660 (888)
T KOG0306|consen 585 HKSFFAHDDSVMSVQFLPKTHLFFTCGKDGKVKQWDGEKFEEIQKLDGHHSEVWCLAVSPNGSFVVSSS----HDKSIRL 660 (888)
T ss_pred hhhhhcccCceeEEEEcccceeEEEecCcceEEeechhhhhhheeeccchheeeeeEEcCCCCeEEecc----CCceeEe
Confidence 54 778999999999999999999999999999999988776 66889999999999999999999884 3444455
Q ss_pred CC
Q 018806 326 AS 327 (350)
Q Consensus 326 ~~ 327 (350)
|.
T Consensus 661 wE 662 (888)
T KOG0306|consen 661 WE 662 (888)
T ss_pred ee
Confidence 54
No 82
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.88 E-value=4.2e-21 Score=147.85 Aligned_cols=214 Identities=16% Similarity=0.164 Sum_probs=160.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC-CC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG-NA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~-~~ 179 (350)
+|..++.+.|...+++++.|+.+.+||+++ ++....+ .+|.+.|+.++|+.+...+++++.|.++++||.+... .+
T Consensus 61 EVlD~~~s~Dnskf~s~GgDk~v~vwDV~T--Gkv~Rr~-rgH~aqVNtV~fNeesSVv~SgsfD~s~r~wDCRS~s~eP 137 (307)
T KOG0316|consen 61 EVLDAALSSDNSKFASCGGDKAVQVWDVNT--GKVDRRF-RGHLAQVNTVRFNEESSVVASGSFDSSVRLWDCRSRSFEP 137 (307)
T ss_pred eeeeccccccccccccCCCCceEEEEEccc--Ceeeeec-ccccceeeEEEecCcceEEEeccccceeEEEEcccCCCCc
Confidence 488888889999999999999999999964 7776666 5899999999999987777777779999999998432 12
Q ss_pred ceeecccccccce--------ecCCCCCceEEeeeccCC-----CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC
Q 018806 180 ASVRSGAASFLGA--------LSRGPGTRWTLVDFLRSQ-----NGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL 246 (350)
Q Consensus 180 ~~~~~~~~~~~~~--------~~~~~~~~~~~~~~~~~~-----~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~ 246 (350)
-++.......+.+ ++.+.++.++..+.-.+. -..+|+++.|++|++..+.++.+ +++++.|-.+|+
T Consensus 138 iQildea~D~V~Si~v~~heIvaGS~DGtvRtydiR~G~l~sDy~g~pit~vs~s~d~nc~La~~l~-stlrLlDk~tGk 216 (307)
T KOG0316|consen 138 IQILDEAKDGVSSIDVAEHEIVAGSVDGTVRTYDIRKGTLSSDYFGHPITSVSFSKDGNCSLASSLD-STLRLLDKETGK 216 (307)
T ss_pred cchhhhhcCceeEEEecccEEEeeccCCcEEEEEeecceeehhhcCCcceeEEecCCCCEEEEeecc-ceeeecccchhH
Confidence 2221111111111 344556666655433221 23589999999999999999999 599999999998
Q ss_pred cee-eeecCCC--eEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCC-eEEEEEcCCCCEEEEEECCCe
Q 018806 247 GTP-IRRGFGG--LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGF-VTGATWDPEGRMILLAFAGSL 318 (350)
Q Consensus 247 ~~~-~~~~~~~--v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~-v~~~~~s~~g~~l~~~~~~~~ 318 (350)
... ..+|... -..++++....++++|++||.|++||+...+.. .+..+... +.+++++|.-.-++++.+...
T Consensus 217 lL~sYkGhkn~eykldc~l~qsdthV~sgSEDG~Vy~wdLvd~~~~sk~~~~~~v~v~dl~~hp~~~~f~~A~~~~~ 293 (307)
T KOG0316|consen 217 LLKSYKGHKNMEYKLDCCLNQSDTHVFSGSEDGKVYFWDLVDETQISKLSVVSTVIVTDLSCHPTMDDFITATGHGD 293 (307)
T ss_pred HHHHhcccccceeeeeeeecccceeEEeccCCceEEEEEeccceeeeeeccCCceeEEeeecccCccceeEecCCce
Confidence 765 4455433 345778888889999999999999999988874 45555555 789999998877777765443
No 83
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.88 E-value=1.6e-21 Score=165.51 Aligned_cols=217 Identities=18% Similarity=0.322 Sum_probs=163.3
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCcc-----------------------------CeeEEEEecCCCEEEEEECCCeEE
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEV-----------------------------DLQGVSWHQHKHIVAFISGSTQVI 124 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~-----------------------------~V~~v~~sp~g~~la~~s~d~~i~ 124 (350)
...+.+|+.-+....+.|...+++.+. .|++++|++.|..|++.+.....+
T Consensus 160 Ei~l~hgtk~Vsal~~Dp~GaR~~sGs~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~aqak 239 (641)
T KOG0772|consen 160 EIQLKHGTKIVSALAVDPSGARFVSGSLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGSAQAK 239 (641)
T ss_pred eEeccCCceEEEEeeecCCCceeeeccccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecCccee
Confidence 355677777777777888877777653 599999999999999999988999
Q ss_pred EEEccCCCCCcee------------EecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCCCCCCceeecccccccc
Q 018806 125 VRDYEDSEGKDAC------------ILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSYPGNAASVRSGAASFLG 191 (350)
Q Consensus 125 iw~~~~~~~~~~~------------~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~ 191 (350)
|+|-+ |..+. ..+++|...+++.+|+|+.+ .+++++.|++++|||+........+...
T Consensus 240 l~DRd---G~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~k~q~qVik~------ 310 (641)
T KOG0772|consen 240 LLDRD---GFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNTKSQLQVIKT------ 310 (641)
T ss_pred EEccC---CceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCchhheeEEee------
Confidence 99975 32222 22358999999999999854 5777788999999999854433222111
Q ss_pred eecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee----eeecCC--CeEEEEEcCC
Q 018806 192 ALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP----IRRGFG--GLSILKWSPT 265 (350)
Q Consensus 192 ~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~----~~~~~~--~v~~~~~sp~ 265 (350)
...+...-.++.++|+|||+.||++..| |.|.+|+..+..... ...|.. .|+++.||+|
T Consensus 311 --------------k~~~g~Rv~~tsC~~nrdg~~iAagc~D-GSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~d 375 (641)
T KOG0772|consen 311 --------------KPAGGKRVPVTSCAWNRDGKLIAAGCLD-GSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYD 375 (641)
T ss_pred --------------ccCCCcccCceeeecCCCcchhhhcccC-CceeeeecCCcccccceEeeeccCCCCceeEEEeccc
Confidence 1111223578999999999999999999 899999986543322 223554 7999999999
Q ss_pred CCEEEEEecCCeEEEEeCCCCcee--cccc--CCCCeEEEEEcCCCCEEEEEE
Q 018806 266 GDYFFAAKFDGTFYLWETNTWTSE--PWSS--TSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 266 g~~l~~~~~d~~v~iwd~~~~~~~--~~~~--~~~~v~~~~~s~~g~~l~~~~ 314 (350)
|++|++-+.|+++++||++..+.- ...+ ...+-+.++|||+.++|++|.
T Consensus 376 g~~LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~TGt 428 (641)
T KOG0772|consen 376 GNYLLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILTGT 428 (641)
T ss_pred cchhhhccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEecc
Confidence 999999999999999999987652 1221 233457899999999999986
No 84
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.88 E-value=1.2e-21 Score=156.53 Aligned_cols=229 Identities=13% Similarity=0.223 Sum_probs=181.6
Q ss_pred ccccchhhhhhhhhhccccccCCCCcCCCCcc--------------------------CeeEEEEecCCCEEEEEECCCe
Q 018806 69 EGEGLFSTLHGIISHSIKPLLHPDHVHLLPEV--------------------------DLQGVSWHQHKHIVAFISGSTQ 122 (350)
Q Consensus 69 ~~~~~~~~~~gh~~~~~~~~~~p~~~~~~~~~--------------------------~V~~v~~sp~g~~la~~s~d~~ 122 (350)
.+..++++|-.|..++....++|....+..+. +|.+++|+|.|.+|+.|..-.+
T Consensus 160 a~hPvIRTlYDH~devn~l~FHPre~ILiS~srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~ 239 (430)
T KOG0640|consen 160 ARHPVIRTLYDHVDEVNDLDFHPRETILISGSRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPT 239 (430)
T ss_pred cCCceEeehhhccCcccceeecchhheEEeccCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCc
Confidence 34578999999999999999999877777643 6999999999999999999999
Q ss_pred EEEEEccCCCCCceeE--ecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCc
Q 018806 123 VIVRDYEDSEGKDACI--LTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTR 200 (350)
Q Consensus 123 i~iw~~~~~~~~~~~~--~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 200 (350)
+++||+++ .++... -..+|.+.|+++.+++.|+.+++++.||.|++||--..+++..+.
T Consensus 240 ~rlYdv~T--~QcfvsanPd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~rCv~t~~----------------- 300 (430)
T KOG0640|consen 240 LRLYDVNT--YQCFVSANPDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSNRCVRTIG----------------- 300 (430)
T ss_pred eeEEeccc--eeEeeecCcccccccceeEEEecCCccEEEEeccCCcEEeeccccHHHHHHHH-----------------
Confidence 99999965 333222 223689999999999999999999999999999977554443322
Q ss_pred eEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC---C---CeEEEEEcCCCCEEEEEec
Q 018806 201 WTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF---G---GLSILKWSPTGDYFFAAKF 274 (350)
Q Consensus 201 ~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~---~---~v~~~~~sp~g~~l~~~~~ 274 (350)
..|.+..|.+..|..+|+++++.+.|+ .+++|.+.++.......+. + --+...|+....+++.-.+
T Consensus 301 -------~AH~gsevcSa~Ftkn~kyiLsSG~DS-~vkLWEi~t~R~l~~YtGAg~tgrq~~rtqAvFNhtEdyVl~pDE 372 (430)
T KOG0640|consen 301 -------NAHGGSEVCSAVFTKNGKYILSSGKDS-TVKLWEISTGRMLKEYTGAGTTGRQKHRTQAVFNHTEDYVLFPDE 372 (430)
T ss_pred -------hhcCCceeeeEEEccCCeEEeecCCcc-eeeeeeecCCceEEEEecCCcccchhhhhhhhhcCccceEEcccc
Confidence 234557899999999999999999996 9999999999876544332 1 2345678888888876654
Q ss_pred -CCeEEEEeCCCCceecc--ccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 275 -DGTFYLWETNTWTSEPW--SSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 275 -d~~v~iwd~~~~~~~~~--~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
.+.+.-||.++.....+ .+|.+.+..+.-||.+.-+++++ .++..++|-.
T Consensus 373 as~slcsWdaRtadr~~l~slgHn~a~R~i~HSP~~p~FmTcs----dD~raRFWyr 425 (430)
T KOG0640|consen 373 ASNSLCSWDARTADRVALLSLGHNGAVRWIVHSPVEPAFMTCS----DDFRARFWYR 425 (430)
T ss_pred ccCceeeccccchhhhhhcccCCCCCceEEEeCCCCCceeeec----ccceeeeeee
Confidence 56899999999887543 48999999999999999999885 3445555543
No 85
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.88 E-value=1.1e-20 Score=158.48 Aligned_cols=228 Identities=10% Similarity=0.138 Sum_probs=167.0
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..|++|.|||....|++|+.|+.++||.++.+....+..+. -...+|.+.+|.|+|. .+++++....++.||+...+.
T Consensus 214 ~~I~sv~FHp~~plllvaG~d~~lrifqvDGk~N~~lqS~~-l~~fPi~~a~f~p~G~~~i~~s~rrky~ysyDle~ak~ 292 (514)
T KOG2055|consen 214 GGITSVQFHPTAPLLLVAGLDGTLRIFQVDGKVNPKLQSIH-LEKFPIQKAEFAPNGHSVIFTSGRRKYLYSYDLETAKV 292 (514)
T ss_pred CCceEEEecCCCceEEEecCCCcEEEEEecCccChhheeee-eccCccceeeecCCCceEEEecccceEEEEeecccccc
Confidence 37999999999999999999999999999855444444432 3567899999999998 666677779999999984432
Q ss_pred Ccee--ecccccccceecCCCCCceEE----------eeeccC------CCCCceeeEEECCCCCeEEEEEeCCCeEEEE
Q 018806 179 AASV--RSGAASFLGALSRGPGTRWTL----------VDFLRS------QNGEQITALSWGPDGRYLASASYESSSFTIW 240 (350)
Q Consensus 179 ~~~~--~~~~~~~~~~~~~~~~~~~~~----------~~~~~~------~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iw 240 (350)
.+.- ..........|..+.++.+.. +....+ .-.+.|.++.|+.||+.|++++.+ |.|++|
T Consensus 293 ~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~G~I~lLhakT~eli~s~KieG~v~~~~fsSdsk~l~~~~~~-GeV~v~ 371 (514)
T KOG2055|consen 293 TKLKPPYGVEEKSMERFEVSHDSNFIAIAGNNGHIHLLHAKTKELITSFKIEGVVSDFTFSSDSKELLASGGT-GEVYVW 371 (514)
T ss_pred ccccCCCCcccchhheeEecCCCCeEEEcccCceEEeehhhhhhhhheeeeccEEeeEEEecCCcEEEEEcCC-ceEEEE
Confidence 2111 111111223344444443332 211111 013688999999999999999989 799999
Q ss_pred eCCCCCceeeeecCCCe--EEEEEcCCCCEEEEEecCCeEEEEeCCCCc----ee---ccccCCCCeEEEEEcCCCCEEE
Q 018806 241 DVAQGLGTPIRRGFGGL--SILKWSPTGDYFFAAKFDGTFYLWETNTWT----SE---PWSSTSGFVTGATWDPEGRMIL 311 (350)
Q Consensus 241 d~~~~~~~~~~~~~~~v--~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~----~~---~~~~~~~~v~~~~~s~~g~~l~ 311 (350)
|++...+.......+.+ +++|.+++|.+||+|+..|.|.|||.++-- .. .+..-...|+++.|++|++.|+
T Consensus 372 nl~~~~~~~rf~D~G~v~gts~~~S~ng~ylA~GS~~GiVNIYd~~s~~~s~~PkPik~~dNLtt~Itsl~Fn~d~qiLA 451 (514)
T KOG2055|consen 372 NLRQNSCLHRFVDDGSVHGTSLCISLNGSYLATGSDSGIVNIYDGNSCFASTNPKPIKTVDNLTTAITSLQFNHDAQILA 451 (514)
T ss_pred ecCCcceEEEEeecCccceeeeeecCCCceEEeccCcceEEEeccchhhccCCCCchhhhhhhheeeeeeeeCcchhhhh
Confidence 99999877766666665 467778999999999999999999976532 22 2334566899999999999999
Q ss_pred EEE-CCCeEEEEEEeCCCC
Q 018806 312 LAF-AGSLTLGSIHFASKP 329 (350)
Q Consensus 312 ~~~-~~~~~~~~~~~~~~~ 329 (350)
.++ .....+..+++.+..
T Consensus 452 iaS~~~knalrLVHvPS~T 470 (514)
T KOG2055|consen 452 IASRVKKNALRLVHVPSCT 470 (514)
T ss_pred hhhhccccceEEEecccee
Confidence 988 555788888887653
No 86
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.88 E-value=6.6e-21 Score=159.50 Aligned_cols=208 Identities=16% Similarity=0.317 Sum_probs=149.9
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCcee-------EecCCCCCCeeEEEEeeCC-CeEEEEecCCcEE
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDAC-------ILTSDSQRDVKVLEWRPNG-GRSLSVGCKGGIC 169 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~-------~~~~~~~~~v~~~~~sp~~-~~l~~~~~d~~v~ 169 (350)
...|+.+..-|+. .+||+.+..+.+.|||.......... ....+|.+.-++++|++.. .++++++.|++|+
T Consensus 124 ~gEVnRaRymPQnp~iVAt~t~~~dv~Vfd~tk~~s~~~~~~~~~Pdl~L~gH~~eg~glsWn~~~~g~Lls~~~d~~i~ 203 (422)
T KOG0264|consen 124 DGEVNRARYMPQNPNIVATKTSSGDVYVFDYTKHPSKPKASGECRPDLRLKGHEKEGYGLSWNRQQEGTLLSGSDDHTIC 203 (422)
T ss_pred CccchhhhhCCCCCcEEEecCCCCCEEEEEeccCCCcccccccCCCceEEEeecccccccccccccceeEeeccCCCcEE
Confidence 3345555555554 67777888999999998654332221 1234788878899999874 3566777789999
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCC-eEEEEEeCCCeEEEEeCCCC--C
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGR-YLASASYESSSFTIWDVAQG--L 246 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~-~l~~~~~d~g~i~iwd~~~~--~ 246 (350)
+||+......... ......+.+|. ..|..++|++-.. .+++++.| +.+.|||++++ +
T Consensus 204 lwdi~~~~~~~~~------------------~~p~~~~~~h~-~~VeDV~~h~~h~~lF~sv~dd-~~L~iwD~R~~~~~ 263 (422)
T KOG0264|consen 204 LWDINAESKEDKV------------------VDPKTIFSGHE-DVVEDVAWHPLHEDLFGSVGDD-GKLMIWDTRSNTSK 263 (422)
T ss_pred EEeccccccCCcc------------------ccceEEeecCC-cceehhhccccchhhheeecCC-CeEEEEEcCCCCCC
Confidence 9999854432111 11244577886 7999999999654 55666666 79999999963 2
Q ss_pred ce-eeeecCCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEE
Q 018806 247 GT-PIRRGFGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGS 322 (350)
Q Consensus 247 ~~-~~~~~~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~ 322 (350)
.. ....|.+.+.|++|+|- +..||+|+.|++|++||+++.+. ..+.+|...|..+.|||+...++++++.+.++..
T Consensus 264 ~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~LwDlRnL~~~lh~~e~H~dev~~V~WSPh~etvLASSg~D~rl~v 343 (422)
T KOG0264|consen 264 PSHSVKAHSAEVNCVAFNPFNEFILATGSADKTVALWDLRNLNKPLHTFEGHEDEVFQVEWSPHNETVLASSGTDRRLNV 343 (422)
T ss_pred CcccccccCCceeEEEeCCCCCceEEeccCCCcEEEeechhcccCceeccCCCcceEEEEeCCCCCceeEecccCCcEEE
Confidence 22 34568899999999995 55678999999999999998765 5677999999999999988777666544444444
Q ss_pred EEeC
Q 018806 323 IHFA 326 (350)
Q Consensus 323 ~~~~ 326 (350)
|++.
T Consensus 344 WDls 347 (422)
T KOG0264|consen 344 WDLS 347 (422)
T ss_pred Eecc
Confidence 4443
No 87
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.88 E-value=1.5e-20 Score=146.39 Aligned_cols=219 Identities=15% Similarity=0.309 Sum_probs=159.1
Q ss_pred CeeEEEEecC-CCEEEEEE-------CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEE
Q 018806 101 DLQGVSWHQH-KHIVAFIS-------GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIW 171 (350)
Q Consensus 101 ~V~~v~~sp~-g~~la~~s-------~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iw 171 (350)
.=.++.|||- .++||.+. ..|.+.|.++....+-....- ..-...+..++|+++.. .++++..||++++|
T Consensus 10 ~GysvqfSPf~~nrLavAt~q~yGl~G~G~L~ile~~~~~gi~e~~s-~d~~D~LfdV~Wse~~e~~~~~a~GDGSLrl~ 88 (311)
T KOG0277|consen 10 HGYSVQFSPFVENRLAVATAQHYGLAGNGRLFILEVTDPKGIQECQS-YDTEDGLFDVAWSENHENQVIAASGDGSLRLF 88 (311)
T ss_pred ccceeEecccccchhheeehhhcccccCceEEEEecCCCCCeEEEEe-eecccceeEeeecCCCcceEEEEecCceEEEe
Confidence 3467889983 24455443 478899999863333322222 24567899999998754 56666779999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCcee-
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGTP- 249 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~~- 249 (350)
|+..+..+ +..++.|. ..|.++.|++ +++.+++++.| |+|++|+...++...
T Consensus 89 d~~~~s~P------------------------i~~~kEH~-~EV~Svdwn~~~r~~~ltsSWD-~TiKLW~~~r~~Sv~T 142 (311)
T KOG0277|consen 89 DLTMPSKP------------------------IHKFKEHK-REVYSVDWNTVRRRIFLTSSWD-GTIKLWDPNRPNSVQT 142 (311)
T ss_pred ccCCCCcc------------------------hhHHHhhh-hheEEeccccccceeEEeeccC-CceEeecCCCCcceEe
Confidence 97644332 33466775 7999999998 56677888889 799999998776554
Q ss_pred eeecCCCeEEEEEcC-CCCEEEEEecCCeEEEEeCCC-CceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC-
Q 018806 250 IRRGFGGLSILKWSP-TGDYFFAAKFDGTFYLWETNT-WTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA- 326 (350)
Q Consensus 250 ~~~~~~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~~~-~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~- 326 (350)
..+|...|+..+|+| ....+++++.|+++++||++. |+...+..|...+.++.|+.-...++++++.+..++.|++.
T Consensus 143 f~gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lwdvr~~gk~~~i~ah~~Eil~cdw~ky~~~vl~Tg~vd~~vr~wDir~ 222 (311)
T KOG0277|consen 143 FNGHNSCIYQAAFSPHIPNLFASASGDGTLRLWDVRSPGKFMSIEAHNSEILCCDWSKYNHNVLATGGVDNLVRGWDIRN 222 (311)
T ss_pred ecCCccEEEEEecCCCCCCeEEEccCCceEEEEEecCCCceeEEEeccceeEeecccccCCcEEEecCCCceEEEEehhh
Confidence 556888999999999 477889999999999999986 44456778889999999999766666555444445555544
Q ss_pred -CCCC-CCceeecccccceeec
Q 018806 327 -SKPP-SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 327 -~~~~-~~~~~~~~v~~~~~~~ 346 (350)
..+. .+.+|...|+...+++
T Consensus 223 ~r~pl~eL~gh~~AVRkvk~Sp 244 (311)
T KOG0277|consen 223 LRTPLFELNGHGLAVRKVKFSP 244 (311)
T ss_pred ccccceeecCCceEEEEEecCc
Confidence 4333 7789999888766553
No 88
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.87 E-value=2.5e-21 Score=163.95 Aligned_cols=199 Identities=14% Similarity=0.176 Sum_probs=165.8
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
+.-++++.++|||+.|++|+.-.++.|||+...+......+. ...-.+.+++.+||.+..+++.+||.|.|||+....
T Consensus 465 dnyiRSckL~pdgrtLivGGeastlsiWDLAapTprikaelt-ssapaCyALa~spDakvcFsccsdGnI~vwDLhnq~- 542 (705)
T KOG0639|consen 465 DNYIRSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIKAELT-SSAPACYALAISPDAKVCFSCCSDGNIAVWDLHNQT- 542 (705)
T ss_pred ccceeeeEecCCCceEEeccccceeeeeeccCCCcchhhhcC-CcchhhhhhhcCCccceeeeeccCCcEEEEEcccce-
Confidence 446899999999999999999999999999766544333332 334568889999998888888889999999998332
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeE
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLS 258 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~ 258 (350)
+++.+++|. ..+.+|..++||..|-+++.|+ +|+.||++++...........|.
T Consensus 543 ------------------------~VrqfqGht-DGascIdis~dGtklWTGGlDn-tvRcWDlregrqlqqhdF~SQIf 596 (705)
T KOG0639|consen 543 ------------------------LVRQFQGHT-DGASCIDISKDGTKLWTGGLDN-TVRCWDLREGRQLQQHDFSSQIF 596 (705)
T ss_pred ------------------------eeecccCCC-CCceeEEecCCCceeecCCCcc-ceeehhhhhhhhhhhhhhhhhhe
Confidence 466789997 5899999999999999999996 99999999887665555568899
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
++..+|++.||++|.+++.+.|......+..++..|+.-|.++.|++.|+++++.+ ++..+..|+..
T Consensus 597 SLg~cP~~dWlavGMens~vevlh~skp~kyqlhlheScVLSlKFa~cGkwfvStG-kDnlLnawrtP 663 (705)
T KOG0639|consen 597 SLGYCPTGDWLAVGMENSNVEVLHTSKPEKYQLHLHESCVLSLKFAYCGKWFVSTG-KDNLLNAWRTP 663 (705)
T ss_pred ecccCCCccceeeecccCcEEEEecCCccceeecccccEEEEEEecccCceeeecC-chhhhhhccCc
Confidence 99999999999999999999999888777778889999999999999999998764 33345555543
No 89
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.87 E-value=4.4e-21 Score=148.44 Aligned_cols=198 Identities=16% Similarity=0.278 Sum_probs=150.9
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEee--CCCeEEEEecCCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRP--NGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp--~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
|..+...--|++||+++.|++|+|+......+........+|.++|+.++|.. -|..|++++.||+|.||.-..+
T Consensus 14 IHda~lDyygkrlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iLAScsYDgkVIiWke~~g--- 90 (299)
T KOG1332|consen 14 IHDAQLDYYGKRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAHPKFGTILASCSYDGKVIIWKEENG--- 90 (299)
T ss_pred hhHhhhhhhcceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecccccCcEeeEeecCceEEEEecCCC---
Confidence 45555556789999999999999999985544233444469999999999965 5777788888999999997733
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEEEEeCCCeEEEEeCCCC-C---ceeeeec
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLASASYESSSFTIWDVAQG-L---GTPIRRG 253 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~g~i~iwd~~~~-~---~~~~~~~ 253 (350)
+|.-......|. ..|++++|.|. |-.|++++.| |.|.+.+.+.. . ......|
T Consensus 91 --------------------~w~k~~e~~~h~-~SVNsV~wapheygl~LacasSD-G~vsvl~~~~~g~w~t~ki~~aH 148 (299)
T KOG1332|consen 91 --------------------RWTKAYEHAAHS-ASVNSVAWAPHEYGLLLACASSD-GKVSVLTYDSSGGWTTSKIVFAH 148 (299)
T ss_pred --------------------chhhhhhhhhhc-ccceeecccccccceEEEEeeCC-CcEEEEEEcCCCCccchhhhhcc
Confidence 222233355665 79999999996 6678899999 79999988765 2 1234568
Q ss_pred CCCeEEEEEcCC---C-----------CEEEEEecCCeEEEEeCCCCce---eccccCCCCeEEEEEcCCC----CEEEE
Q 018806 254 FGGLSILKWSPT---G-----------DYFFAAKFDGTFYLWETNTWTS---EPWSSTSGFVTGATWDPEG----RMILL 312 (350)
Q Consensus 254 ~~~v~~~~~sp~---g-----------~~l~~~~~d~~v~iwd~~~~~~---~~~~~~~~~v~~~~~s~~g----~~l~~ 312 (350)
.-++.+++|.|- | +.|++|+.|..|+||+..+++- ..+.+|...|..++|.|.- .+|++
T Consensus 149 ~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~~~~~w~~e~~l~~H~dwVRDVAwaP~~gl~~s~iAS 228 (299)
T KOG1332|consen 149 EIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKFDSDSWKLERTLEGHKDWVRDVAWAPSVGLPKSTIAS 228 (299)
T ss_pred ccccceeeecCcCCCccccccCcccccceeeccCCccceeeeecCCcchhhhhhhhhcchhhhhhhhccccCCCceeeEE
Confidence 889999999985 5 5699999999999999988643 4578999999999999964 45665
Q ss_pred EE-CCCeEEEEEE
Q 018806 313 AF-AGSLTLGSIH 324 (350)
Q Consensus 313 ~~-~~~~~~~~~~ 324 (350)
++ ++...+|..+
T Consensus 229 ~SqDg~viIwt~~ 241 (299)
T KOG1332|consen 229 CSQDGTVIIWTKD 241 (299)
T ss_pred ecCCCcEEEEEec
Confidence 55 4445555544
No 90
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.87 E-value=1.6e-19 Score=138.51 Aligned_cols=212 Identities=14% Similarity=0.188 Sum_probs=151.1
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCC--------CC----CceeEecCCCCCCeeEEEEeeCCCeEEEEecCCc
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS--------EG----KDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGG 167 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~--------~~----~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~ 167 (350)
..|++++|+|.|.+.|+|++.++.+|.....- .. ...+.-.+.|.+.|.+.+|+|+|+.+++++.|++
T Consensus 33 qairav~fhp~g~lyavgsnskt~ric~yp~l~~~r~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~geliatgsndk~ 112 (350)
T KOG0641|consen 33 QAIRAVAFHPAGGLYAVGSNSKTFRICAYPALIDLRHAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCGELIATGSNDKT 112 (350)
T ss_pred hheeeEEecCCCceEEeccCCceEEEEccccccCcccccccccCCCeEEeeeccccCccEEEEEecCccCeEEecCCCce
Confidence 46999999999999999999999998754210 00 1122233468899999999999888888888999
Q ss_pred EEEEecCCCCCCceee----cccccccce-------------ecCCCCCceE----------EeeeccCCCCCceeeEEE
Q 018806 168 ICIWAPSYPGNAASVR----SGAASFLGA-------------LSRGPGTRWT----------LVDFLRSQNGEQITALSW 220 (350)
Q Consensus 168 v~iwd~~~~~~~~~~~----~~~~~~~~~-------------~~~~~~~~~~----------~~~~~~~~~~~~v~~~~~ 220 (350)
|++..++...+...-. ......+.. +.....+..+ -...+.+|. +.|.++ +
T Consensus 113 ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~tdc~~g~~~~a~sght-ghilal-y 190 (350)
T KOG0641|consen 113 IKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYITDCGRGQGFHALSGHT-GHILAL-Y 190 (350)
T ss_pred EEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEeecCCCCcceeecCCc-ccEEEE-E
Confidence 9998776332211100 001111111 2222222222 123456676 455554 2
Q ss_pred CCCCCeEEEEEeCCCeEEEEeCCCCCceeeee---c-----CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-ecc
Q 018806 221 GPDGRYLASASYESSSFTIWDVAQGLGTPIRR---G-----FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPW 291 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~---~-----~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~ 291 (350)
+-+|-.+++++.|. +|++||++-..+..... | ...|.+++..|.|++|++|..|....+||++.+.. +.+
T Consensus 191 swn~~m~~sgsqdk-tirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dssc~lydirg~r~iq~f 269 (350)
T KOG0641|consen 191 SWNGAMFASGSQDK-TIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSSCMLYDIRGGRMIQRF 269 (350)
T ss_pred EecCcEEEccCCCc-eEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCceEEEEeeCCceeeee
Confidence 33578999999995 99999999887665443 1 24688999999999999999999999999999987 557
Q ss_pred ccCCCCeEEEEEcCCCCEEEEEE
Q 018806 292 SSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 292 ~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
..|...|.++.|||...+|++++
T Consensus 270 ~phsadir~vrfsp~a~yllt~s 292 (350)
T KOG0641|consen 270 HPHSADIRCVRFSPGAHYLLTCS 292 (350)
T ss_pred CCCccceeEEEeCCCceEEEEec
Confidence 78999999999999999999875
No 91
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.86 E-value=5.7e-20 Score=154.36 Aligned_cols=224 Identities=13% Similarity=0.147 Sum_probs=171.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+|.+++-+|+|.+|+.|...|.+++|.+.+ |..+..+ ..|-..|+++.|+-||..+++++.||.|.+|.+..--.
T Consensus 81 Pg~v~al~s~n~G~~l~ag~i~g~lYlWelss--G~LL~v~-~aHYQ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~ 157 (476)
T KOG0646|consen 81 PGPVHALASSNLGYFLLAGTISGNLYLWELSS--GILLNVL-SAHYQSITCLKFSDDGSHIITGSKDGAVLVWLLTDLVS 157 (476)
T ss_pred ccceeeeecCCCceEEEeecccCcEEEEEecc--ccHHHHH-HhhccceeEEEEeCCCcEEEecCCCccEEEEEEEeecc
Confidence 34699999999999999888999999999954 7776666 58999999999999999999999999999999862110
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLASASYESSSFTIWDVAQGLGTPIRRGFGG 256 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~ 256 (350)
...+........+..|. -+|+++...+. ..+|++++.|. ++++||+..+........+..
T Consensus 158 ----------------a~~~~~~~p~~~f~~Ht-lsITDl~ig~Gg~~~rl~TaS~D~-t~k~wdlS~g~LLlti~fp~s 219 (476)
T KOG0646|consen 158 ----------------ADNDHSVKPLHIFSDHT-LSITDLQIGSGGTNARLYTASEDR-TIKLWDLSLGVLLLTITFPSS 219 (476)
T ss_pred ----------------cccCCCccceeeeccCc-ceeEEEEecCCCccceEEEecCCc-eEEEEEeccceeeEEEecCCc
Confidence 00111122345567776 68999988765 46799999995 999999999988777778899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCc-----------------eeccccCCC--CeEEEEEcCCCCEEEEEECCC
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWT-----------------SEPWSSTSG--FVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~-----------------~~~~~~~~~--~v~~~~~s~~g~~l~~~~~~~ 317 (350)
+.+++.+|-++.+++|+.+|.|.+.++.... ...+.+|.+ .|++++.+-||..|++|. .+
T Consensus 220 i~av~lDpae~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSGd-~d 298 (476)
T KOG0646|consen 220 IKAVALDPAERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSGD-ED 298 (476)
T ss_pred ceeEEEcccccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEecCccEEEeeC-CC
Confidence 9999999999999999999999998875433 122447777 999999999999999776 22
Q ss_pred eEEEEEEeCCCC--CCCceeeccccccee
Q 018806 318 LTLGSIHFASKP--PSLDAHLLPVDLPDI 344 (350)
Q Consensus 318 ~~~~~~~~~~~~--~~~~~~~~~v~~~~~ 344 (350)
..+..|++.++. .++.....||+...+
T Consensus 299 g~VcvWdi~S~Q~iRtl~~~kgpVtnL~i 327 (476)
T KOG0646|consen 299 GKVCVWDIYSKQCIRTLQTSKGPVTNLQI 327 (476)
T ss_pred CCEEEEecchHHHHHHHhhhccccceeEe
Confidence 345555555433 244334555554444
No 92
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.86 E-value=2.7e-19 Score=150.12 Aligned_cols=225 Identities=15% Similarity=0.174 Sum_probs=169.0
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
.+...+.+++.|+||++||+|+.|..|.||+.++ .+.+..+ .+|.+.|.+++|--....+++++.|+++++|+++..
T Consensus 200 ~h~keil~~avS~Dgkylatgg~d~~v~Iw~~~t--~ehv~~~-~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~ 276 (479)
T KOG0299|consen 200 GHVKEILTLAVSSDGKYLATGGRDRHVQIWDCDT--LEHVKVF-KGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQL 276 (479)
T ss_pred cccceeEEEEEcCCCcEEEecCCCceEEEecCcc--cchhhcc-cccccceeeeeeecCccceeeeecCCceEEEehhHh
Confidence 4556799999999999999999999999999965 4444443 689999999999887788999999999999999844
Q ss_pred CCCceeecc--------cccccceecCC-CCCceEEee-------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEE
Q 018806 177 GNAASVRSG--------AASFLGALSRG-PGTRWTLVD-------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIW 240 (350)
Q Consensus 177 ~~~~~~~~~--------~~~~~~~~~~~-~~~~~~~~~-------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iw 240 (350)
.....+... .......+..+ -|....+|+ .+.++. +.+-+++|-. ..++++|+.+ |.|.+|
T Consensus 277 s~vetlyGHqd~v~~IdaL~reR~vtVGgrDrT~rlwKi~eesqlifrg~~-~sidcv~~In-~~HfvsGSdn-G~IaLW 353 (479)
T KOG0299|consen 277 SYVETLYGHQDGVLGIDALSRERCVTVGGRDRTVRLWKIPEESQLIFRGGE-GSIDCVAFIN-DEHFVSGSDN-GSIALW 353 (479)
T ss_pred HHHHHHhCCccceeeechhcccceEEeccccceeEEEeccccceeeeeCCC-CCeeeEEEec-ccceeeccCC-ceEEEe
Confidence 333322211 11111112222 344445554 344553 6888888865 4688899888 899999
Q ss_pred eCCCCCceeeee--c-----------CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce----eccccCCCCeEEEEE
Q 018806 241 DVAQGLGTPIRR--G-----------FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS----EPWSSTSGFVTGATW 303 (350)
Q Consensus 241 d~~~~~~~~~~~--~-----------~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~----~~~~~~~~~v~~~~~ 303 (350)
++...++..... | +.+|++++..|...++++|+.+|.|++|-+..+-. ..-....+.|++++|
T Consensus 354 s~~KKkplf~~~~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS~~G~vrLW~i~~g~r~i~~l~~ls~~GfVNsl~f 433 (479)
T KOG0299|consen 354 SLLKKKPLFTSRLAHGVIPELDPVNGNFWITSLAVIPGSDLLASGSWSGCVRLWKIEDGLRAINLLYSLSLVGFVNSLAF 433 (479)
T ss_pred eecccCceeEeeccccccCCccccccccceeeeEecccCceEEecCCCCceEEEEecCCccccceeeecccccEEEEEEE
Confidence 999887654331 2 12789999999999999999999999999988732 222246788999999
Q ss_pred cCCCCEEEEEECCCeEEEEEEeCC
Q 018806 304 DPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 304 s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
+++|+.|++|.+..-.++.|-...
T Consensus 434 ~~sgk~ivagiGkEhRlGRW~~~k 457 (479)
T KOG0299|consen 434 SNSGKRIVAGIGKEHRLGRWWCLK 457 (479)
T ss_pred ccCCCEEEEecccccccceeeEee
Confidence 999999999988888888887653
No 93
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.86 E-value=3.6e-21 Score=156.13 Aligned_cols=205 Identities=14% Similarity=0.207 Sum_probs=158.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|+|+.+. ...+++|..|++|+|||.+. -.+...+ .+|.+.|.|+.|.. +.++++++|.+|+|||.++++.
T Consensus 199 gVYClQYD--D~kiVSGlrDnTikiWD~n~--~~c~~~L-~GHtGSVLCLqyd~--rviisGSSDsTvrvWDv~tge~-- 269 (499)
T KOG0281|consen 199 GVYCLQYD--DEKIVSGLRDNTIKIWDKNS--LECLKIL-TGHTGSVLCLQYDE--RVIVSGSSDSTVRVWDVNTGEP-- 269 (499)
T ss_pred ceEEEEec--chhhhcccccCceEEecccc--HHHHHhh-hcCCCcEEeeeccc--eEEEecCCCceEEEEeccCCch--
Confidence 68999885 45689999999999999853 4444444 59999999999853 5677777799999999996554
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce----eeeecCCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT----PIRRGFGG 256 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~----~~~~~~~~ 256 (350)
++++-+|. ..|..+.|+. .++++++.|. ++.+||+.+.... .+.+|...
T Consensus 270 -----------------------l~tlihHc-eaVLhlrf~n--g~mvtcSkDr-siaVWdm~sps~it~rrVLvGHrAa 322 (499)
T KOG0281|consen 270 -----------------------LNTLIHHC-EAVLHLRFSN--GYMVTCSKDR-SIAVWDMASPTDITLRRVLVGHRAA 322 (499)
T ss_pred -----------------------hhHHhhhc-ceeEEEEEeC--CEEEEecCCc-eeEEEeccCchHHHHHHHHhhhhhh
Confidence 34455665 6899999974 5899999995 9999999987643 35578889
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCce
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDA 334 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~ 334 (350)
|..+.|+ .++|++++.|++|++|++.+++. ..+.+|...|.++.+ .|+++++|+ +..+.+|++.-......+.+
T Consensus 323 VNvVdfd--~kyIVsASgDRTikvW~~st~efvRtl~gHkRGIAClQY--r~rlvVSGSSDntIRlwdi~~G~cLRvLeG 398 (499)
T KOG0281|consen 323 VNVVDFD--DKYIVSASGDRTIKVWSTSTCEFVRTLNGHKRGIACLQY--RDRLVVSGSSDNTIRLWDIECGACLRVLEG 398 (499)
T ss_pred eeeeccc--cceEEEecCCceEEEEeccceeeehhhhcccccceehhc--cCeEEEecCCCceEEEEeccccHHHHHHhc
Confidence 9999985 56999999999999999999998 456789888887765 478888776 44455555444444447788
Q ss_pred eecccccceee
Q 018806 335 HLLPVDLPDIV 345 (350)
Q Consensus 335 ~~~~v~~~~~~ 345 (350)
|..-|+...+.
T Consensus 399 HEeLvRciRFd 409 (499)
T KOG0281|consen 399 HEELVRCIRFD 409 (499)
T ss_pred hHHhhhheeec
Confidence 88777766554
No 94
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.85 E-value=9.6e-22 Score=173.03 Aligned_cols=187 Identities=20% Similarity=0.344 Sum_probs=158.6
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
++.+|.++.|+++..+|+.|+.+|+|++||++. .+.+..+ .+|...+.++.|+|-+.+.+.++.|..+++||.+..+
T Consensus 69 hespIeSl~f~~~E~LlaagsasgtiK~wDlee--Ak~vrtL-tgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~G 145 (825)
T KOG0267|consen 69 HESPIESLTFDTSERLLAAGSASGTIKVWDLEE--AKIVRTL-TGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKG 145 (825)
T ss_pred cCCcceeeecCcchhhhcccccCCceeeeehhh--hhhhhhh-hccccCcceeeeccceEEeccccccccceehhhhccC
Confidence 345699999999999999999999999999963 5555555 4899999999999998777667779999999999554
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ecCCC
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RGFGG 256 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~~~~ 256 (350)
+ ...+.+|. ..+..+.|+|+|++++.++.|+ +++|||...|+...-+ .|.+.
T Consensus 146 c-------------------------~~~~~s~~-~vv~~l~lsP~Gr~v~~g~ed~-tvki~d~~agk~~~ef~~~e~~ 198 (825)
T KOG0267|consen 146 C-------------------------SHTYKSHT-RVVDVLRLSPDGRWVASGGEDN-TVKIWDLTAGKLSKEFKSHEGK 198 (825)
T ss_pred c-------------------------eeeecCCc-ceeEEEeecCCCceeeccCCcc-eeeeeccccccccccccccccc
Confidence 4 44566665 6889999999999999999995 9999999999876544 58899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+..+.|+|..-.++.|+.|++|++||+++.+.. ........|.+.+|+|+|+.+++|.
T Consensus 199 v~sle~hp~e~Lla~Gs~d~tv~f~dletfe~I~s~~~~~~~v~~~~fn~~~~~~~~G~ 257 (825)
T KOG0267|consen 199 VQSLEFHPLEVLLAPGSSDRTVRFWDLETFEVISSGKPETDGVRSLAFNPDGKIVLSGE 257 (825)
T ss_pred ccccccCchhhhhccCCCCceeeeeccceeEEeeccCCccCCceeeeecCCceeeecCc
Confidence 999999999989999999999999999987763 3444567899999999999988775
No 95
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.85 E-value=3.8e-19 Score=150.90 Aligned_cols=235 Identities=12% Similarity=0.156 Sum_probs=172.4
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
-|.|++|.++|+ +++|..+|.|.||+... .+...... .|++.|.+++...+ ..|++++.|+.|..||-...+...
T Consensus 248 ~Vl~v~F~engd-viTgDS~G~i~Iw~~~~--~~~~k~~~-aH~ggv~~L~~lr~-GtllSGgKDRki~~Wd~~y~k~r~ 322 (626)
T KOG2106|consen 248 FVLCVTFLENGD-VITGDSGGNILIWSKGT--NRISKQVH-AHDGGVFSLCMLRD-GTLLSGGKDRKIILWDDNYRKLRE 322 (626)
T ss_pred EEEEEEEcCCCC-EEeecCCceEEEEeCCC--ceEEeEee-ecCCceEEEEEecC-ccEeecCccceEEecccccccccc
Confidence 599999999998 55899999999999843 33333443 89999999999998 577788889999999954332222
Q ss_pred eeecccccccceecCCCCCc-------eEE--------eeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC
Q 018806 181 SVRSGAASFLGALSRGPGTR-------WTL--------VDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG 245 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~-------~~~--------~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~ 245 (350)
.-.+....++..+..+..+- ..+ .....+|. ...+.++.+|+...+++++.| +.+++|+ ..
T Consensus 323 ~elPe~~G~iRtv~e~~~di~vGTtrN~iL~Gt~~~~f~~~v~gh~-delwgla~hps~~q~~T~gqd-k~v~lW~--~~ 398 (626)
T KOG2106|consen 323 TELPEQFGPIRTVAEGKGDILVGTTRNFILQGTLENGFTLTVQGHG-DELWGLATHPSKNQLLTCGQD-KHVRLWN--DH 398 (626)
T ss_pred ccCchhcCCeeEEecCCCcEEEeeccceEEEeeecCCceEEEEecc-cceeeEEcCCChhheeeccCc-ceEEEcc--CC
Confidence 11222233333333332221 111 12345665 488999999999999999999 5999999 44
Q ss_pred CceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 246 LGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 246 ~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
+.........+..++.|+|.| .+|.|...|...+.|.++....++.....+++.++|+|+|.+||+++ ++.+++|.++
T Consensus 399 k~~wt~~~~d~~~~~~fhpsg-~va~Gt~~G~w~V~d~e~~~lv~~~~d~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs 477 (626)
T KOG2106|consen 399 KLEWTKIIEDPAECADFHPSG-VVAVGTATGRWFVLDTETQDLVTIHTDNEQLSVVRYSPDGAFLAVGSHDNHIYIYRVS 477 (626)
T ss_pred ceeEEEEecCceeEeeccCcc-eEEEeeccceEEEEecccceeEEEEecCCceEEEEEcCCCCEEEEecCCCeEEEEEEC
Confidence 555555567889999999999 99999999999999999977777666688999999999999999998 7777777776
Q ss_pred eCCCCCCC--ceeecccccceee
Q 018806 325 FASKPPSL--DAHLLPVDLPDIV 345 (350)
Q Consensus 325 ~~~~~~~~--~~~~~~v~~~~~~ 345 (350)
-....... ..|..||+...++
T Consensus 478 ~~g~~y~r~~k~~gs~ithLDwS 500 (626)
T KOG2106|consen 478 ANGRKYSRVGKCSGSPITHLDWS 500 (626)
T ss_pred CCCcEEEEeeeecCceeEEeeec
Confidence 66543311 1333666665554
No 96
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.85 E-value=7.2e-21 Score=155.04 Aligned_cols=228 Identities=15% Similarity=0.171 Sum_probs=161.7
Q ss_pred ccchhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeE
Q 018806 71 EGLFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKV 149 (350)
Q Consensus 71 ~~~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~ 149 (350)
+.+++.|.||..+ |.|++=+|.. ..+|+|+.||.|+|||+.. ..+...+ ..|.+.|..
T Consensus 56 kPFv~~L~gHrdG------------------V~~lakhp~~ls~~aSGs~DG~VkiWnlsq--R~~~~~f-~AH~G~V~G 114 (433)
T KOG0268|consen 56 KPFVGSLDGHRDG------------------VSCLAKHPNKLSTVASGSCDGEVKIWNLSQ--RECIRTF-KAHEGLVRG 114 (433)
T ss_pred ccchhhccccccc------------------cchhhcCcchhhhhhccccCceEEEEehhh--hhhhhee-ecccCceee
Confidence 4566777888777 5555555555 6799999999999999963 3444444 589999999
Q ss_pred EEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccc-c-----cccceecCCCCCceEEeee--------ccCCCCCce
Q 018806 150 LEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGA-A-----SFLGALSRGPGTRWTLVDF--------LRSQNGEQI 215 (350)
Q Consensus 150 ~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~-~-----~~~~~~~~~~~~~~~~~~~--------~~~~~~~~v 215 (350)
+++.. ..++++|.|++|+.|.++.+ ....+.... . ..........+..+.+|+. +.-.. ..|
T Consensus 115 i~v~~--~~~~tvgdDKtvK~wk~~~~-p~~tilg~s~~~gIdh~~~~~~FaTcGe~i~IWD~~R~~Pv~smswG~-Dti 190 (433)
T KOG0268|consen 115 ICVTQ--TSFFTVGDDKTVKQWKIDGP-PLHTILGKSVYLGIDHHRKNSVFATCGEQIDIWDEQRDNPVSSMSWGA-DSI 190 (433)
T ss_pred EEecc--cceEEecCCcceeeeeccCC-cceeeeccccccccccccccccccccCceeeecccccCCccceeecCC-Cce
Confidence 99986 68999999999999998742 111111110 0 0001111122223333432 22112 367
Q ss_pred eeEEECCCCCe-EEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccc
Q 018806 216 TALSWGPDGRY-LASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWS 292 (350)
Q Consensus 216 ~~~~~sp~g~~-l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~ 292 (350)
.++.|+|-... |++++.| +.|.+||++.+.+.......-....++|+|.+-.++++++|..++.||++..+. ....
T Consensus 191 ~svkfNpvETsILas~~sD-rsIvLyD~R~~~Pl~KVi~~mRTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~~ 269 (433)
T KOG0268|consen 191 SSVKFNPVETSILASCASD-RSIVLYDLRQASPLKKVILTMRTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNVHK 269 (433)
T ss_pred eEEecCCCcchheeeeccC-CceEEEecccCCccceeeeeccccceecCccccceeeccccccceehhhhhhcccchhhc
Confidence 88999997654 5566677 699999999988766544455667899999887788999999999999987665 4566
Q ss_pred cCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 293 STSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 293 ~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
+|.+.|.+++|||.|+-+++|+ |..+.++.++
T Consensus 270 dhvsAV~dVdfsptG~EfvsgsyDksIRIf~~~ 302 (433)
T KOG0268|consen 270 DHVSAVMDVDFSPTGQEFVSGSYDKSIRIFPVN 302 (433)
T ss_pred ccceeEEEeccCCCcchhccccccceEEEeecC
Confidence 8999999999999999999997 7666666654
No 97
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.85 E-value=1.3e-19 Score=158.13 Aligned_cols=198 Identities=17% Similarity=0.284 Sum_probs=158.8
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|-+++|+ +..+.+|+.++.|..+|+.. .+.......+|...|..++|++|+.++++++.|+.+.|||......
T Consensus 260 ~~rvg~laW~--~~~lssGsr~~~I~~~dvR~--~~~~~~~~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~~~~~p 335 (484)
T KOG0305|consen 260 ASRVGSLAWN--SSVLSSGSRDGKILNHDVRI--SQHVVSTLQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDGLSPEP 335 (484)
T ss_pred CceeEEEecc--CceEEEecCCCcEEEEEEec--chhhhhhhhcccceeeeeEECCCCCeeccCCCccceEeccCCCccc
Confidence 4479999998 67888999999999999965 3333333468999999999999999999999999999999953322
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEE--eCCCeEEEEeCCCCCceeeeecCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASAS--YESSSFTIWDVAQGLGTPIRRGFG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~--~d~g~i~iwd~~~~~~~~~~~~~~ 255 (350)
...+..|. +.|.+++|+|- ...||+|+ .| ++|++||..++..........
T Consensus 336 -------------------------~~~~~~H~-aAVKA~awcP~q~~lLAsGGGs~D-~~i~fwn~~~g~~i~~vdtgs 388 (484)
T KOG0305|consen 336 -------------------------KFTFTEHT-AAVKALAWCPWQSGLLATGGGSAD-RCIKFWNTNTGARIDSVDTGS 388 (484)
T ss_pred -------------------------cEEEeccc-eeeeEeeeCCCccCceEEcCCCcc-cEEEEEEcCCCcEecccccCC
Confidence 23355665 79999999995 45666653 46 699999999998888777889
Q ss_pred CeEEEEEcCCCCEEEEE--ecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 256 GLSILKWSPTGDYFFAA--KFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~--~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
.|+.+.|++..+.|+++ ..++.|.||++.+.+. ..+.+|...|..++++|||..+++++.+. .+..|+++..
T Consensus 389 QVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~l~gH~~RVl~la~SPdg~~i~t~a~DE-Tlrfw~~f~~ 463 (484)
T KOG0305|consen 389 QVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAELLGHTSRVLYLALSPDGETIVTGAADE-TLRFWNLFDE 463 (484)
T ss_pred ceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeeeecCCcceeEEEEECCCCCEEEEecccC-cEEeccccCC
Confidence 99999999998777655 3467899999999777 56789999999999999999999887443 5566666653
No 98
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.85 E-value=2.6e-20 Score=165.27 Aligned_cols=193 Identities=19% Similarity=0.380 Sum_probs=149.0
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCC
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYP 176 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~ 176 (350)
.-.|+++.|++.. .+|++|++||.|++||+..+.. ...+.+....|..++|+|.....+++..| |.+++||++..
T Consensus 133 ~Rs~~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S---~~t~~~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDlRqp 209 (839)
T KOG0269|consen 133 ERSANKLDFHSTEPNILISGSQDGTVKCWDLRSKKS---KSTFRSNSESIRDVKFSPGYGNKFASIHDSGYLQLWDLRQP 209 (839)
T ss_pred ccceeeeeeccCCccEEEecCCCceEEEEeeecccc---cccccccchhhhceeeccCCCceEEEecCCceEEEeeccCc
Confidence 3469999999865 7889999999999999975332 22334567889999999987777777776 99999999954
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee--eeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP--IRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~--~~~~~ 254 (350)
... ...+..|. +.|.++.|+|++.+||+|+.| +.|+|||+.+++... .....
T Consensus 210 ~r~------------------------~~k~~AH~-GpV~c~nwhPnr~~lATGGRD-K~vkiWd~t~~~~~~~~tInTi 263 (839)
T KOG0269|consen 210 DRC------------------------EKKLTAHN-GPVLCLNWHPNREWLATGGRD-KMVKIWDMTDSRAKPKHTINTI 263 (839)
T ss_pred hhH------------------------HHHhhccc-CceEEEeecCCCceeeecCCC-ccEEEEeccCCCccceeEEeec
Confidence 432 23366776 899999999999999999999 599999999776543 33456
Q ss_pred CCeEEEEEcCCCCE-EEEEec--CCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 255 GGLSILKWSPTGDY-FFAAKF--DGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 255 ~~v~~~~~sp~g~~-l~~~~~--d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
.++.++.|-|+.++ ||+++. |-.|+|||++..-+ ..+..|...++.++|......++..++++..+
T Consensus 264 apv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvrRPYIP~~t~~eH~~~vt~i~W~~~d~~~l~s~sKD~tv 334 (839)
T KOG0269|consen 264 APVGRVKWRPARSYHLATCSMVVDTSVHVWDVRRPYIPYATFLEHTDSVTGIAWDSGDRINLWSCSKDGTV 334 (839)
T ss_pred ceeeeeeeccCccchhhhhhccccceEEEEeeccccccceeeeccCccccceeccCCCceeeEeecCccHH
Confidence 88999999998665 666654 77999999988766 45668999999999977555555555554433
No 99
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.85 E-value=2e-20 Score=158.54 Aligned_cols=193 Identities=13% Similarity=0.129 Sum_probs=164.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
..++++.|||.+...++..||.|.|||+.. ... ...+.+|...+.||..++||.+|-++|-|++|+.||++......
T Consensus 511 aCyALa~spDakvcFsccsdGnI~vwDLhn--q~~-VrqfqGhtDGascIdis~dGtklWTGGlDntvRcWDlregrqlq 587 (705)
T KOG0639|consen 511 ACYALAISPDAKVCFSCCSDGNIAVWDLHN--QTL-VRQFQGHTDGASCIDISKDGTKLWTGGLDNTVRCWDLREGRQLQ 587 (705)
T ss_pred hhhhhhcCCccceeeeeccCCcEEEEEccc--cee-eecccCCCCCceeEEecCCCceeecCCCccceeehhhhhhhhhh
Confidence 568889999999999999999999999963 333 44447999999999999999999999999999999999655432
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSIL 260 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~ 260 (350)
.-. -.+.|.++..+|.+.+++.+-.+ +.+.+......+...+..|...|.++
T Consensus 588 qhd---------------------------F~SQIfSLg~cP~~dWlavGMen-s~vevlh~skp~kyqlhlheScVLSl 639 (705)
T KOG0639|consen 588 QHD---------------------------FSSQIFSLGYCPTGDWLAVGMEN-SNVEVLHTSKPEKYQLHLHESCVLSL 639 (705)
T ss_pred hhh---------------------------hhhhheecccCCCccceeeeccc-CcEEEEecCCccceeecccccEEEEE
Confidence 211 12689999999999999999888 59999988877777778889999999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
.|.+.|+|+++.+.|+-+..|.+.-|...--......|.++.+|-|.++|++|+ ++...+|.+-
T Consensus 640 KFa~cGkwfvStGkDnlLnawrtPyGasiFqskE~SsVlsCDIS~ddkyIVTGSGdkkATVYeV~ 704 (705)
T KOG0639|consen 640 KFAYCGKWFVSTGKDNLLNAWRTPYGASIFQSKESSSVLSCDISFDDKYIVTGSGDKKATVYEVI 704 (705)
T ss_pred EecccCceeeecCchhhhhhccCccccceeeccccCcceeeeeccCceEEEecCCCcceEEEEEe
Confidence 999999999999999999999998887755556678899999999999999998 5567888764
No 100
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.84 E-value=1.6e-19 Score=148.02 Aligned_cols=200 Identities=21% Similarity=0.418 Sum_probs=146.2
Q ss_pred eeEEEEecCC--CEEEEEECCCeEEEEEccCC-------------CCCceeEecCCCCCCeeEEEEeeC-CCeEEEEecC
Q 018806 102 LQGVSWHQHK--HIVAFISGSTQVIVRDYEDS-------------EGKDACILTSDSQRDVKVLEWRPN-GGRSLSVGCK 165 (350)
Q Consensus 102 V~~v~~sp~g--~~la~~s~d~~i~iw~~~~~-------------~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d 165 (350)
++.+.-++-+ .+.|+=+..|.|+||++... ..........+|.+.=+.++|||- ...++++..-
T Consensus 154 ~NRvr~~~~~~~~~~aswse~G~V~Vw~l~~~l~~l~~~~~~~~~s~~~Pl~t~~ghk~EGy~LdWSp~~~g~LlsGDc~ 233 (440)
T KOG0302|consen 154 INRVRVSRLGNEVLCASWSENGRVQVWDLAPHLNALSEPGLEVKDSEFRPLFTFNGHKGEGYGLDWSPIKTGRLLSGDCV 233 (440)
T ss_pred cceeeecccCCcceeeeecccCcEEEEEchhhhhhhcCccccccccccCceEEecccCccceeeecccccccccccCccc
Confidence 4444444443 55666677899999998420 011112223478888899999994 2356666667
Q ss_pred CcEEEEecCCCCCCceeecccccccceecCCCCCceEE-eeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCC
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTL-VDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVA 243 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~ 243 (350)
+.|++|....+ .|.. ...+.+|. ..|..++|||.. ..|++++.| |+|+|||++
T Consensus 234 ~~I~lw~~~~g-----------------------~W~vd~~Pf~gH~-~SVEDLqWSptE~~vfaScS~D-gsIrIWDiR 288 (440)
T KOG0302|consen 234 KGIHLWEPSTG-----------------------SWKVDQRPFTGHT-KSVEDLQWSPTEDGVFASCSCD-GSIRIWDIR 288 (440)
T ss_pred cceEeeeeccC-----------------------ceeecCccccccc-cchhhhccCCccCceEEeeecC-ceEEEEEec
Confidence 99999988732 2222 12466776 799999999964 567888889 799999999
Q ss_pred CCC---ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee----ccccCCCCeEEEEEcCCCCEEEEEE--
Q 018806 244 QGL---GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE----PWSSTSGFVTGATWDPEGRMILLAF-- 314 (350)
Q Consensus 244 ~~~---~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~----~~~~~~~~v~~~~~s~~g~~l~~~~-- 314 (350)
.+. +.....|.+.|..+.|+.+..+||+|+.||+++|||++.-+.. .+..|..+|+++.|+|....++.++
T Consensus 289 s~~~~~~~~~kAh~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e~s~iaasg~ 368 (440)
T KOG0302|consen 289 SGPKKAAVSTKAHNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHEDSVIAASGE 368 (440)
T ss_pred CCCccceeEeeccCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCCcceeEEeccCCeeEEEeccccCceEEeccC
Confidence 984 3445678899999999999889999999999999999987653 6778999999999999765544443
Q ss_pred CCCeEEEEEEeC
Q 018806 315 AGSLTLGSIHFA 326 (350)
Q Consensus 315 ~~~~~~~~~~~~ 326 (350)
++.+.+|++.+.
T Consensus 369 D~QitiWDlsvE 380 (440)
T KOG0302|consen 369 DNQITIWDLSVE 380 (440)
T ss_pred CCcEEEEEeecc
Confidence 555666666554
No 101
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.84 E-value=6e-20 Score=160.08 Aligned_cols=206 Identities=17% Similarity=0.171 Sum_probs=159.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE-eeCCCeEEEEecCCcEEEEecCCCCC-
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW-RPNGGRSLSVGCKGGICIWAPSYPGN- 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~-sp~~~~l~~~~~d~~v~iwd~~~~~~- 178 (350)
.|..+...-+|+.|+++|.|-+|++|+.......+...+ ..|...|.+++. .++...++++|-|+.|.+||++....
T Consensus 75 WVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~~c~sti-r~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~ 153 (735)
T KOG0308|consen 75 WVNDIILCGNGKTLISASSDTTVKVWNAHKDNTFCMSTI-RTHKDYVKCLAYIAKNNELVASGGLDRKIFLWDINTGTAT 153 (735)
T ss_pred HHhhHHhhcCCCceEEecCCceEEEeecccCcchhHhhh-hcccchheeeeecccCceeEEecCCCccEEEEEccCcchh
Confidence 477777778999999999999999999864322333333 479999999999 66755666666699999999995532
Q ss_pred -CceeecccccccceecCCCCCceEEeeecc-CCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeeeecCC
Q 018806 179 -AASVRSGAASFLGALSRGPGTRWTLVDFLR-SQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIRRGFG 255 (350)
Q Consensus 179 -~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~~~~~ 255 (350)
...+... ....+. |+. ..|++++.++.|..|++|+.+ +.+++||.++++. ..+.+|..
T Consensus 154 l~~s~n~~-----------------t~~sl~sG~k-~siYSLA~N~t~t~ivsGgte-k~lr~wDprt~~kimkLrGHTd 214 (735)
T KOG0308|consen 154 LVASFNNV-----------------TVNSLGSGPK-DSIYSLAMNQTGTIIVSGGTE-KDLRLWDPRTCKKIMKLRGHTD 214 (735)
T ss_pred hhhhcccc-----------------ccccCCCCCc-cceeeeecCCcceEEEecCcc-cceEEeccccccceeeeecccc
Confidence 1111111 011122 554 699999999999999999999 5999999999865 46788999
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
.|..+..++||+.+++++.||+|++||+...++ .++..|...|+++.-+|+=..+++|+ .+..++.-++.+
T Consensus 215 NVr~ll~~dDGt~~ls~sSDgtIrlWdLgqQrCl~T~~vH~e~VWaL~~~~sf~~vYsG~-rd~~i~~Tdl~n 286 (735)
T KOG0308|consen 215 NVRVLLVNDDGTRLLSASSDGTIRLWDLGQQRCLATYIVHKEGVWALQSSPSFTHVYSGG-RDGNIYRTDLRN 286 (735)
T ss_pred ceEEEEEcCCCCeEeecCCCceEEeeeccccceeeeEEeccCceEEEeeCCCcceEEecC-CCCcEEecccCC
Confidence 999999999999999999999999999988887 45778888999999999988888775 223444444443
No 102
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.84 E-value=6e-19 Score=159.51 Aligned_cols=221 Identities=16% Similarity=0.268 Sum_probs=162.2
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
.+....+.|+|.|+|.+|.+++.||.|++|+..... ..+..+. .+...|.+++-. +.+|++++.+++|.+|.+...
T Consensus 11 aht~G~t~i~~d~~gefi~tcgsdg~ir~~~~~sd~-e~P~ti~-~~g~~v~~ia~~--s~~f~~~s~~~tv~~y~fps~ 86 (933)
T KOG1274|consen 11 AHTGGLTLICYDPDGEFICTCGSDGDIRKWKTNSDE-EEPETID-ISGELVSSIACY--SNHFLTGSEQNTVLRYKFPSG 86 (933)
T ss_pred hccCceEEEEEcCCCCEEEEecCCCceEEeecCCcc-cCCchhh-ccCceeEEEeec--ccceEEeeccceEEEeeCCCC
Confidence 444558899999999999999999999999976431 3333332 266778777764 458888888999999999855
Q ss_pred CCCceeecccccccce---------ecCC-CCCceEEe--------eeccCCCCCceeeEEECCCCCeEEEEEeCCCeEE
Q 018806 177 GNAASVRSGAASFLGA---------LSRG-PGTRWTLV--------DFLRSQNGEQITALSWGPDGRYLASASYESSSFT 238 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~---------~~~~-~~~~~~~~--------~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~ 238 (350)
..-..+... ..+... ++.+ .+..++++ ..+++|. ++|.++.|+|.+.+||+.+.| |.|+
T Consensus 87 ~~~~iL~Rf-tlp~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lrgh~-apVl~l~~~p~~~fLAvss~d-G~v~ 163 (933)
T KOG1274|consen 87 EEDTILARF-TLPIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLRGHD-APVLQLSYDPKGNFLAVSSCD-GKVQ 163 (933)
T ss_pred Cccceeeee-eccceEEEEecCCcEEEeecCceeEEEEeccccchheeecccC-CceeeeeEcCCCCEEEEEecC-ceEE
Confidence 443232222 112222 2222 22233333 3577886 899999999999999999999 8999
Q ss_pred EEeCCCCCceeeeec---------CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee---ccccCCCCeEEEEEcCC
Q 018806 239 IWDVAQGLGTPIRRG---------FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE---PWSSTSGFVTGATWDPE 306 (350)
Q Consensus 239 iwd~~~~~~~~~~~~---------~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~---~~~~~~~~v~~~~~s~~ 306 (350)
+||+.++........ ...+..++|+|+|..+++...|+.|++|+..++... ....+...+..+.|+|+
T Consensus 164 iw~~~~~~~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~wsPn 243 (933)
T KOG1274|consen 164 IWDLQDGILSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVPPVDNTVKVYSRKGWELQFKLRDKLSSSKFSDLQWSPN 243 (933)
T ss_pred EEEcccchhhhhcccCCccccccccceeeeeeecCCCCeEEeeccCCeEEEEccCCceeheeecccccccceEEEEEcCC
Confidence 999998865433221 234567999999888888889999999999998773 22234445899999999
Q ss_pred CCEEEEEE-CCCeEEEEEE
Q 018806 307 GRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 307 g~~l~~~~-~~~~~~~~~~ 324 (350)
|+|||++. ++.+.+|.|+
T Consensus 244 G~YiAAs~~~g~I~vWnv~ 262 (933)
T KOG1274|consen 244 GKYIAASTLDGQILVWNVD 262 (933)
T ss_pred CcEEeeeccCCcEEEEecc
Confidence 99999988 8888888888
No 103
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.84 E-value=1.4e-20 Score=158.64 Aligned_cols=162 Identities=18% Similarity=0.290 Sum_probs=140.1
Q ss_pred cCCCCCCeeEEEEee-CCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeE
Q 018806 140 TSDSQRDVKVLEWRP-NGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITAL 218 (350)
Q Consensus 140 ~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 218 (350)
..+|...|+++.|.| .+..+++++.|+.|+||++-..+ .+++++.+|. ..|.++
T Consensus 210 ~~gH~kgvsai~~fp~~~hLlLS~gmD~~vklW~vy~~~------------------------~~lrtf~gH~-k~Vrd~ 264 (503)
T KOG0282|consen 210 LSGHTKGVSAIQWFPKKGHLLLSGGMDGLVKLWNVYDDR------------------------RCLRTFKGHR-KPVRDA 264 (503)
T ss_pred ccCCccccchhhhccceeeEEEecCCCceEEEEEEecCc------------------------ceehhhhcch-hhhhhh
Confidence 358999999999999 66667777779999999997422 3577789997 799999
Q ss_pred EECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCcee-ccccCCC
Q 018806 219 SWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTSE-PWSSTSG 296 (350)
Q Consensus 219 ~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~ 296 (350)
+|+++|..+++++.| +.|++||+++|++...+.....+.++.|+|++ +.+++|+.|+.|+.||+++++.. ....|-+
T Consensus 265 ~~s~~g~~fLS~sfD-~~lKlwDtETG~~~~~f~~~~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~kvvqeYd~hLg 343 (503)
T KOG0282|consen 265 SFNNCGTSFLSASFD-RFLKLWDTETGQVLSRFHLDKVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSGKVVQEYDRHLG 343 (503)
T ss_pred hccccCCeeeeeecc-eeeeeeccccceEEEEEecCCCceeeecCCCCCcEEEEecCCCcEEEEeccchHHHHHHHhhhh
Confidence 999999999999999 59999999999998888888889999999998 77889999999999999999984 4557888
Q ss_pred CeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCC
Q 018806 297 FVTGATWDPEGRMILLAF-AGSLTLGSIHFAS 327 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~ 327 (350)
.|..+.|-++|+.+++++ ++...+|+++..-
T Consensus 344 ~i~~i~F~~~g~rFissSDdks~riWe~~~~v 375 (503)
T KOG0282|consen 344 AILDITFVDEGRRFISSSDDKSVRIWENRIPV 375 (503)
T ss_pred heeeeEEccCCceEeeeccCccEEEEEcCCCc
Confidence 999999999999999888 5556777776553
No 104
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.84 E-value=2.1e-20 Score=154.70 Aligned_cols=223 Identities=13% Similarity=0.145 Sum_probs=158.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|..+.|-++...|++|+.|..|++|+...........+ .+..++|+++.|.+++.++++++.|+.+++|++.....
T Consensus 175 ~gev~~v~~l~~sdtlatgg~Dr~Ik~W~v~~~k~~~~~tL-aGs~g~it~~d~d~~~~~~iAas~d~~~r~Wnvd~~r~ 253 (459)
T KOG0288|consen 175 EGEVHDVEFLRNSDTLATGGSDRIIKLWNVLGEKSELISTL-AGSLGNITSIDFDSDNKHVIAASNDKNLRLWNVDSLRL 253 (459)
T ss_pred ccccceeEEccCcchhhhcchhhhhhhhhcccchhhhhhhh-hccCCCcceeeecCCCceEEeecCCCceeeeeccchhh
Confidence 44799999999999999999999999999974332233333 46778999999999999999999999999999984332
Q ss_pred Cc-------eeecccccccc--eecCCCCCceEEeeeccCC------CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC
Q 018806 179 AA-------SVRSGAASFLG--ALSRGPGTRWTLVDFLRSQ------NGEQITALSWGPDGRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 179 ~~-------~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~------~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~ 243 (350)
.. ++....+.... .++.+.+..++.|+.-+.. ..+.+.+|..+ ...++++..| ++|++||++
T Consensus 254 ~~TLsGHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~~C~kt~l~~S~cnDI~~~--~~~~~SgH~D-kkvRfwD~R 330 (459)
T KOG0288|consen 254 RHTLSGHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKAYCSKTVLPGSQCNDIVCS--ISDVISGHFD-KKVRFWDIR 330 (459)
T ss_pred hhhhcccccceeeehhhccccceeeccccchhhhhhhhhhheeccccccccccceEec--ceeeeecccc-cceEEEecc
Confidence 22 22222111111 1223333333333211110 01344555555 4567777788 599999999
Q ss_pred CCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-----cCCCCeEEEEEcCCCCEEEEEE-CCC
Q 018806 244 QGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-----STSGFVTGATWDPEGRMILLAF-AGS 317 (350)
Q Consensus 244 ~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-----~~~~~v~~~~~s~~g~~l~~~~-~~~ 317 (350)
+..+.......+.|+++..+++|..|.+++.|.++.+.|+++.+..... ....-.+.+.|||++.|+++|+ ++.
T Consensus 331 s~~~~~sv~~gg~vtSl~ls~~g~~lLsssRDdtl~viDlRt~eI~~~~sA~g~k~asDwtrvvfSpd~~YvaAGS~dgs 410 (459)
T KOG0288|consen 331 SADKTRSVPLGGRVTSLDLSMDGLELLSSSRDDTLKVIDLRTKEIRQTFSAEGFKCASDWTRVVFSPDGSYVAAGSADGS 410 (459)
T ss_pred CCceeeEeecCcceeeEeeccCCeEEeeecCCCceeeeecccccEEEEeeccccccccccceeEECCCCceeeeccCCCc
Confidence 9988877777789999999999999999999999999999998875433 1223478899999999999887 444
Q ss_pred eEEEEEEeCC
Q 018806 318 LTLGSIHFAS 327 (350)
Q Consensus 318 ~~~~~~~~~~ 327 (350)
++.|.+..
T Consensus 411 --v~iW~v~t 418 (459)
T KOG0288|consen 411 --VYIWSVFT 418 (459)
T ss_pred --EEEEEccC
Confidence 44454443
No 105
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.84 E-value=1.3e-19 Score=158.99 Aligned_cols=187 Identities=13% Similarity=0.143 Sum_probs=155.3
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|.+++...++. +++||.|.++++|.. ++....+ .+|...|++++.-|+ +.+++++.|++|++|.-.
T Consensus 103 nVC~ls~~~~~~-~iSgSWD~TakvW~~----~~l~~~l-~gH~asVWAv~~l~e-~~~vTgsaDKtIklWk~~------ 169 (745)
T KOG0301|consen 103 NVCSLSIGEDGT-LISGSWDSTAKVWRI----GELVYSL-QGHTASVWAVASLPE-NTYVTGSADKTIKLWKGG------ 169 (745)
T ss_pred ceeeeecCCcCc-eEecccccceEEecc----hhhhccc-CCcchheeeeeecCC-CcEEeccCcceeeeccCC------
Confidence 488888777887 889999999999998 4444444 689999999999999 589999999999999865
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSIL 260 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~ 260 (350)
.+.+++.+|. ..|+.+++-+++ .++++++| |.|++|++.......+.+|...++++
T Consensus 170 ---------------------~~l~tf~gHt-D~VRgL~vl~~~-~flScsND-g~Ir~w~~~ge~l~~~~ghtn~vYsi 225 (745)
T KOG0301|consen 170 ---------------------TLLKTFSGHT-DCVRGLAVLDDS-HFLSCSND-GSIRLWDLDGEVLLEMHGHTNFVYSI 225 (745)
T ss_pred ---------------------chhhhhccch-hheeeeEEecCC-CeEeecCC-ceEEEEeccCceeeeeeccceEEEEE
Confidence 1356688987 699999998865 67788899 79999999666666788899999999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCCceeccccCC-CCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTS-GFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~-~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
...+++..++++++|++++||+.. ++.+...+. ..|+++.+-++|..++.++|+.++++..+-.
T Consensus 226 s~~~~~~~Ivs~gEDrtlriW~~~--e~~q~I~lPttsiWsa~~L~NgDIvvg~SDG~VrVfT~~k~ 290 (745)
T KOG0301|consen 226 SMALSDGLIVSTGEDRTLRIWKKD--ECVQVITLPTTSIWSAKVLLNGDIVVGGSDGRVRVFTVDKD 290 (745)
T ss_pred EecCCCCeEEEecCCceEEEeecC--ceEEEEecCccceEEEEEeeCCCEEEeccCceEEEEEeccc
Confidence 988888899999999999999887 555444444 4899999999999888777888888887643
No 106
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.84 E-value=2e-19 Score=160.97 Aligned_cols=196 Identities=16% Similarity=0.144 Sum_probs=163.0
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEe--cCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACIL--TSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~--~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
..+++++.++.|++.+.|+..|.|-+|++.. |.....+ ...|+++|+.++...-++.+++++.+|.++.||+....
T Consensus 449 ~~~~av~vs~CGNF~~IG~S~G~Id~fNmQS--Gi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~ 526 (910)
T KOG1539|consen 449 INATAVCVSFCGNFVFIGYSKGTIDRFNMQS--GIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGILKFWDFKKKV 526 (910)
T ss_pred cceEEEEEeccCceEEEeccCCeEEEEEccc--CeeecccccCccccCceeEEEecCCCceEEEccCcceEEEEecCCcc
Confidence 4799999999999999999999999999953 5444444 23699999999998887889999999999999998443
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCC
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGG 256 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~ 256 (350)
....+.. ...+..+..+.....++.+..|- .|+++|+.+.+..+ +.+|...
T Consensus 527 l~~~l~l---------------------------~~~~~~iv~hr~s~l~a~~~ddf-~I~vvD~~t~kvvR~f~gh~nr 578 (910)
T KOG1539|consen 527 LKKSLRL---------------------------GSSITGIVYHRVSDLLAIALDDF-SIRVVDVVTRKVVREFWGHGNR 578 (910)
T ss_pred eeeeecc---------------------------CCCcceeeeeehhhhhhhhcCce-eEEEEEchhhhhhHHhhccccc
Confidence 2222221 24778888888888888888885 99999999887665 4568899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
++.++|||||+||++++.|++|++||+.++.+........+++++.|||+|.+||++.-+...++.|..
T Consensus 579 itd~~FS~DgrWlisasmD~tIr~wDlpt~~lID~~~vd~~~~sls~SPngD~LAT~Hvd~~gIylWsN 647 (910)
T KOG1539|consen 579 ITDMTFSPDGRWLISASMDSTIRTWDLPTGTLIDGLLVDSPCTSLSFSPNGDFLATVHVDQNGIYLWSN 647 (910)
T ss_pred eeeeEeCCCCcEEEEeecCCcEEEEeccCcceeeeEecCCcceeeEECCCCCEEEEEEecCceEEEEEc
Confidence 999999999999999999999999999999998777778899999999999999999855555666543
No 107
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.84 E-value=1e-20 Score=146.90 Aligned_cols=213 Identities=13% Similarity=0.203 Sum_probs=173.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|++..++.+..+.|+++.|-+.+|||.-+ +..+..+ .|..-|.+++|+.|.++|++++.++-++|||++.+..+
T Consensus 61 avw~~~l~~na~~aasaaadftakvw~a~t--gdelhsf--~hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~Ap- 135 (334)
T KOG0278|consen 61 AVWSATLNKNATRAASAAADFTAKVWDAVT--GDELHSF--EHKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAP- 135 (334)
T ss_pred ceeeeecCchhhhhhhhcccchhhhhhhhh--hhhhhhh--hhhheeeeEEecccchhhhccchHHHhhhhhccCCCCC-
Confidence 688889988888999999999999999844 6666655 57888999999999999999999999999999855433
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSIL 260 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~ 260 (350)
...+.+|. +.|..+.|....+.|++++.| ++|++||.+++........+.+|.++
T Consensus 136 -----------------------p~E~~ght-g~Ir~v~wc~eD~~iLSSadd-~tVRLWD~rTgt~v~sL~~~s~VtSl 190 (334)
T KOG0278|consen 136 -----------------------PKEISGHT-GGIRTVLWCHEDKCILSSADD-KTVRLWDHRTGTEVQSLEFNSPVTSL 190 (334)
T ss_pred -----------------------chhhcCCC-CcceeEEEeccCceEEeeccC-CceEEEEeccCcEEEEEecCCCCcce
Confidence 22366776 799999999999999998888 69999999999998888888999999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC--C-Cceeec
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP--S-LDAHLL 337 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~--~-~~~~~~ 337 (350)
..+++|++|..+ ..+.|.+||.++............|.+.+.+|+...++ +++.+..++..++....- . -.+|-.
T Consensus 191 Evs~dG~ilTia-~gssV~Fwdaksf~~lKs~k~P~nV~SASL~P~k~~fV-aGged~~~~kfDy~TgeEi~~~nkgh~g 268 (334)
T KOG0278|consen 191 EVSQDGRILTIA-YGSSVKFWDAKSFGLLKSYKMPCNVESASLHPKKEFFV-AGGEDFKVYKFDYNTGEEIGSYNKGHFG 268 (334)
T ss_pred eeccCCCEEEEe-cCceeEEeccccccceeeccCccccccccccCCCceEE-ecCcceEEEEEeccCCceeeecccCCCC
Confidence 999999876554 56789999999988876666677899999999885555 555666777777764322 3 368888
Q ss_pred ccccceee
Q 018806 338 PVDLPDIV 345 (350)
Q Consensus 338 ~v~~~~~~ 345 (350)
||.+..+.
T Consensus 269 pVhcVrFS 276 (334)
T KOG0278|consen 269 PVHCVRFS 276 (334)
T ss_pred ceEEEEEC
Confidence 88766554
No 108
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.83 E-value=4.3e-19 Score=142.34 Aligned_cols=219 Identities=12% Similarity=0.171 Sum_probs=154.4
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
..|+.||+.|.+||+|..||.+.|||+.+.. +.....+|..+|.+++||+||+.|++++.|..+.+||+..+.....
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~---iar~lsaH~~pi~sl~WS~dgr~LltsS~D~si~lwDl~~gs~l~r 102 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTFR---IARMLSAHVRPITSLCWSRDGRKLLTSSRDWSIKLWDLLKGSPLKR 102 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEccccc---hhhhhhccccceeEEEecCCCCEeeeecCCceeEEEeccCCCceeE
Confidence 7899999999999999999999999997532 3444468999999999999999999999999999999996665544
Q ss_pred eecccccccceecCCCCC--ceE---------Ee-------eecc----CCCCCceeeEEECCCCCeEEEEEeCCCeEEE
Q 018806 182 VRSGAASFLGALSRGPGT--RWT---------LV-------DFLR----SQNGEQITALSWGPDGRYLASASYESSSFTI 239 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~--~~~---------~~-------~~~~----~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~i 239 (350)
+.-.. ++....+-+.. +.. +. ..+. +..+....+..|.+.|++|++|... |.+.+
T Consensus 103 irf~s--pv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsK-Gkllv 179 (405)
T KOG1273|consen 103 IRFDS--PVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSK-GKLLV 179 (405)
T ss_pred EEccC--ccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCc-ceEEE
Confidence 43221 11111111110 000 00 0011 1111222344688999999999988 89999
Q ss_pred EeCCCCCceeeee-c-CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC-------Cceec---cc--cCCCCeEEEEEcC
Q 018806 240 WDVAQGLGTPIRR-G-FGGLSILKWSPTGDYFFAAKFDGTFYLWETNT-------WTSEP---WS--STSGFVTGATWDP 305 (350)
Q Consensus 240 wd~~~~~~~~~~~-~-~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~-------~~~~~---~~--~~~~~v~~~~~s~ 305 (350)
+|..+.++..-.. . ...|.++.++..|++|+.-+.|+.|+.|+++. ++... +. -....-.++.||.
T Consensus 180 ~~a~t~e~vas~rits~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~di~~~~r~~e~e~~~K~qDvVNk~~Wk~ccfs~ 259 (405)
T KOG1273|consen 180 YDAETLECVASFRITSVQAIKQIIVSRKGRFLIINTSDRVIRTYEISDIDDEGRDGEVEPEHKLQDVVNKLQWKKCCFSG 259 (405)
T ss_pred EecchheeeeeeeechheeeeEEEEeccCcEEEEecCCceEEEEehhhhcccCccCCcChhHHHHHHHhhhhhhheeecC
Confidence 9999987765333 2 36789999999999999999999999998862 12211 11 1122335788999
Q ss_pred CCCEEEEEECCCeEEEEEEeC
Q 018806 306 EGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 306 ~g~~l~~~~~~~~~~~~~~~~ 326 (350)
+|.|++.++...-.+|.|...
T Consensus 260 dgeYv~a~s~~aHaLYIWE~~ 280 (405)
T KOG1273|consen 260 DGEYVCAGSARAHALYIWEKS 280 (405)
T ss_pred CccEEEeccccceeEEEEecC
Confidence 999999888666666766544
No 109
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.83 E-value=3.6e-19 Score=160.71 Aligned_cols=197 Identities=16% Similarity=0.247 Sum_probs=156.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|+++++..-+.+|++|+.|.++++||. .++.+...+ .+|...|.++...+. .++.++.|.+|++|+++.+.
T Consensus 251 ~V~~l~~~~~~~~lvsgS~D~t~rvWd~--~sg~C~~~l-~gh~stv~~~~~~~~--~~~sgs~D~tVkVW~v~n~~--- 322 (537)
T KOG0274|consen 251 GVWGLAFPSGGDKLVSGSTDKTERVWDC--STGECTHSL-QGHTSSVRCLTIDPF--LLVSGSRDNTVKVWDVTNGA--- 322 (537)
T ss_pred CceeEEEecCCCEEEEEecCCcEEeEec--CCCcEEEEe-cCCCceEEEEEccCc--eEeeccCCceEEEEeccCcc---
Confidence 5999999887899999999999999997 458888877 489999999887643 55566779999999999433
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSI 259 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~ 259 (350)
++..+.+|. +.|.++..+ +..+++++.| |+|++||+.++++.. +.+|...|.+
T Consensus 323 ----------------------~l~l~~~h~-~~V~~v~~~--~~~lvsgs~d-~~v~VW~~~~~~cl~sl~gH~~~V~s 376 (537)
T KOG0274|consen 323 ----------------------CLNLLRGHT-GPVNCVQLD--EPLLVSGSYD-GTVKVWDPRTGKCLKSLSGHTGRVYS 376 (537)
T ss_pred ----------------------eEEEecccc-ccEEEEEec--CCEEEEEecC-ceEEEEEhhhceeeeeecCCcceEEE
Confidence 355567775 799999998 7899999999 699999999998865 5678899999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCC-ce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCce
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTW-TS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDA 334 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~-~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~ 334 (350)
+.+... ..+++|+.|++|++||+++. ++ ..+..|...+..+. ..+++|+++. ++.+.+|+..-......+.+
T Consensus 377 l~~~~~-~~~~Sgs~D~~IkvWdl~~~~~c~~tl~~h~~~v~~l~--~~~~~Lvs~~aD~~Ik~WD~~~~~~~~~~~~ 451 (537)
T KOG0274|consen 377 LIVDSE-NRLLSGSLDTTIKVWDLRTKRKCIHTLQGHTSLVSSLL--LRDNFLVSSSADGTIKLWDAEEGECLRTLEG 451 (537)
T ss_pred EEecCc-ceEEeeeeccceEeecCCchhhhhhhhcCCcccccccc--cccceeEeccccccEEEeecccCceeeeecc
Confidence 988765 78999999999999999999 66 56778888776555 4577888776 55455554444444334444
No 110
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.83 E-value=3.1e-19 Score=141.91 Aligned_cols=213 Identities=13% Similarity=0.264 Sum_probs=153.1
Q ss_pred ccccccCCC-CcCCCCccCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCC--------ceeEe----cCCCCCCeeE
Q 018806 84 SIKPLLHPD-HVHLLPEVDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGK--------DACIL----TSDSQRDVKV 149 (350)
Q Consensus 84 ~~~~~~~p~-~~~~~~~~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~--------~~~~~----~~~~~~~v~~ 149 (350)
+....+.++ +-.-.++..|+++...+ .|+++++|+.||.|.+||+...+.. ..+.+ ..+|.-.|.+
T Consensus 27 il~L~Ln~d~d~~r~HgGsvNsL~id~tegrymlSGgadgsi~v~Dl~n~t~~e~s~li~k~~c~v~~~h~~~Hky~iss 106 (397)
T KOG4283|consen 27 ILSLQLNNDKDFVRPHGGSVNSLQIDLTEGRYMLSGGADGSIAVFDLQNATDYEASGLIAKHKCIVAKQHENGHKYAISS 106 (397)
T ss_pred hheeeccCCcceeccCCCccceeeeccccceEEeecCCCccEEEEEeccccchhhccceeheeeeccccCCccceeeeee
Confidence 444444444 33445677899999987 5799999999999999999753311 11211 2257778999
Q ss_pred EEEeeCCCeEEEE-ecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC---C
Q 018806 150 LEWRPNGGRSLSV-GCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG---R 225 (350)
Q Consensus 150 ~~~sp~~~~l~~~-~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g---~ 225 (350)
+.|-|-+.-+++. +.|.+++|||..+-+.... ++- ++.|.+-+|||-. -
T Consensus 107 ~~WyP~DtGmFtssSFDhtlKVWDtnTlQ~a~~-------------------------F~m--e~~VYshamSp~a~sHc 159 (397)
T KOG4283|consen 107 AIWYPIDTGMFTSSSFDHTLKVWDTNTLQEAVD-------------------------FKM--EGKVYSHAMSPMAMSHC 159 (397)
T ss_pred eEEeeecCceeecccccceEEEeecccceeeEE-------------------------eec--CceeehhhcChhhhcce
Confidence 9999865555554 4599999999984433222 221 2578888888843 3
Q ss_pred eEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEE-EEEecCCeEEEEeCCCCc------------e---
Q 018806 226 YLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYF-FAAKFDGTFYLWETNTWT------------S--- 288 (350)
Q Consensus 226 ~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l-~~~~~d~~v~iwd~~~~~------------~--- 288 (350)
.+|++..+ -.|++.|+.+|.... +.+|.+.|.++.|+|...++ ++|+.||.|++||++... .
T Consensus 160 LiA~gtr~-~~VrLCDi~SGs~sH~LsGHr~~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~ 238 (397)
T KOG4283|consen 160 LIAAGTRD-VQVRLCDIASGSFSHTLSGHRDGVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPI 238 (397)
T ss_pred EEEEecCC-CcEEEEeccCCcceeeeccccCceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecccCccCcc
Confidence 45666666 499999999998765 56788999999999998875 789999999999997531 1
Q ss_pred -eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeC
Q 018806 289 -EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFA 326 (350)
Q Consensus 289 -~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~ 326 (350)
+.-..|.+.+.+++|+.+|.++++++ ++. +..|...
T Consensus 239 ~~~n~ah~gkvngla~tSd~~~l~~~gtd~r--~r~wn~~ 276 (397)
T KOG4283|consen 239 LKTNTAHYGKVNGLAWTSDARYLASCGTDDR--IRVWNME 276 (397)
T ss_pred ccccccccceeeeeeecccchhhhhccCccc--eEEeecc
Confidence 11236788999999999999999876 443 4444443
No 111
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.83 E-value=6.3e-19 Score=140.96 Aligned_cols=209 Identities=11% Similarity=0.109 Sum_probs=153.2
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|++|.|+|.+..|++++.||.+++|++... ..... ..|..++.+++|.++ ..+++++.||.|+.+|+..+..
T Consensus 13 ~d~IS~v~f~~~~~~LLvssWDgslrlYdv~~~--~l~~~--~~~~~plL~c~F~d~-~~~~~G~~dg~vr~~Dln~~~~ 87 (323)
T KOG1036|consen 13 EDGISSVKFSPSSSDLLVSSWDGSLRLYDVPAN--SLKLK--FKHGAPLLDCAFADE-STIVTGGLDGQVRRYDLNTGNE 87 (323)
T ss_pred hhceeeEEEcCcCCcEEEEeccCcEEEEeccch--hhhhh--eecCCceeeeeccCC-ceEEEeccCceEEEEEecCCcc
Confidence 346999999999999999999999999999643 22222 368899999999987 8899999999999999985433
Q ss_pred Cce------eeccccc--ccceecCCCCCceEEeeeccC------CCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC
Q 018806 179 AAS------VRSGAAS--FLGALSRGPGTRWTLVDFLRS------QNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 179 ~~~------~~~~~~~--~~~~~~~~~~~~~~~~~~~~~------~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~ 244 (350)
... +...... ...-++.+.+..+++|+.-.. ...+.|.++.. .|..|+.++.+. .+.+||+++
T Consensus 88 ~~igth~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~kkVy~~~v--~g~~LvVg~~~r-~v~iyDLRn 164 (323)
T KOG1036|consen 88 DQIGTHDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQGKKVYCMDV--SGNRLVVGTSDR-KVLIYDLRN 164 (323)
T ss_pred eeeccCCCceEEEEeeccCCeEEEcccCccEEEEeccccccccccccCceEEEEec--cCCEEEEeecCc-eEEEEEccc
Confidence 221 1111111 112266778888888875421 11245666655 467788888885 899999876
Q ss_pred CC-------------------------------------------------ceeeeecC---------CCeEEEEEcCCC
Q 018806 245 GL-------------------------------------------------GTPIRRGF---------GGLSILKWSPTG 266 (350)
Q Consensus 245 ~~-------------------------------------------------~~~~~~~~---------~~v~~~~~sp~g 266 (350)
.. .-.+..|. .+|.+++|+|--
T Consensus 165 ~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSieGRVavE~~d~s~~~~skkyaFkCHr~~~~~~~~~yPVNai~Fhp~~ 244 (323)
T KOG1036|consen 165 LDEPFQRRESSLKYQTRCVALVPNGEGYVVSSIEGRVAVEYFDDSEEAQSKKYAFKCHRLSEKDTEIIYPVNAIAFHPIH 244 (323)
T ss_pred ccchhhhccccceeEEEEEEEecCCCceEEEeecceEEEEccCCchHHhhhceeEEeeecccCCceEEEEeceeEecccc
Confidence 40 00111121 268899999998
Q ss_pred CEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 267 DYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 267 ~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
..||+|+.||.|.+||+.+.+. .++......|.+++|+.+|..||++++
T Consensus 245 ~tfaTgGsDG~V~~Wd~~~rKrl~q~~~~~~SI~slsfs~dG~~LAia~s 294 (323)
T KOG1036|consen 245 GTFATGGSDGIVNIWDLFNRKRLKQLAKYETSISSLSFSMDGSLLAIASS 294 (323)
T ss_pred ceEEecCCCceEEEccCcchhhhhhccCCCCceEEEEeccCCCeEEEEec
Confidence 8999999999999999998876 456666778999999999999999863
No 112
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.83 E-value=4.3e-20 Score=160.94 Aligned_cols=205 Identities=13% Similarity=0.185 Sum_probs=160.3
Q ss_pred cCCCEEEEEECCCeEEEEEccCCCCC----ceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeec
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDSEGK----DACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRS 184 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~~~~----~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~ 184 (350)
|.+++|.+|+.||.|++|++...... ....+ ..|...|+.+....+++.++++++|-+|++|+......
T Consensus 35 ~~~ryLfTgGRDg~i~~W~~~~d~~~~s~~~~asm-e~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~------ 107 (735)
T KOG0308|consen 35 PNGRYLFTGGRDGIIRLWSVTQDSNEPSTPYIASM-EHHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNT------ 107 (735)
T ss_pred CCCceEEecCCCceEEEeccccccCCcccchhhhh-hhhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcc------
Confidence 46788999999999999998654332 12222 36889999999999989999999999999999984321
Q ss_pred ccccccceecCCCCCceEEeeeccCCCCCceeeEEE-CCCCCeEEEEEeCCCeEEEEeCCCCCc--e---------eee-
Q 018806 185 GAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW-GPDGRYLASASYESSSFTIWDVAQGLG--T---------PIR- 251 (350)
Q Consensus 185 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~-sp~g~~l~~~~~d~g~i~iwd~~~~~~--~---------~~~- 251 (350)
.+..++..|. ..|.+++. .++...+++|+.| +.|.+||++++.. . .+.
T Consensus 108 -----------------~c~stir~H~-DYVkcla~~ak~~~lvaSgGLD-~~IflWDin~~~~~l~~s~n~~t~~sl~s 168 (735)
T KOG0308|consen 108 -----------------FCMSTIRTHK-DYVKCLAYIAKNNELVASGGLD-RKIFLWDINTGTATLVASFNNVTVNSLGS 168 (735)
T ss_pred -----------------hhHhhhhccc-chheeeeecccCceeEEecCCC-ccEEEEEccCcchhhhhhccccccccCCC
Confidence 1345577776 69999999 8888999999999 5999999998732 1 111
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCC
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKP 329 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~ 329 (350)
++...+++++.++.|..|++|+..+.+++||.++++. ..+.+|...|..+..++||+.+++++ ++.+.+|.+.-..+.
T Consensus 169 G~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgtIrlWdLgqQrCl 248 (735)
T KOG0308|consen 169 GPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGTIRLWDLGQQRCL 248 (735)
T ss_pred CCccceeeeecCCcceEEEecCcccceEEeccccccceeeeeccccceEEEEEcCCCCeEeecCCCceEEeeecccccee
Confidence 4557899999999999999999999999999999876 67889999999999999999999886 444444444333334
Q ss_pred CCCceeeccc
Q 018806 330 PSLDAHLLPV 339 (350)
Q Consensus 330 ~~~~~~~~~v 339 (350)
.++..|...|
T Consensus 249 ~T~~vH~e~V 258 (735)
T KOG0308|consen 249 ATYIVHKEGV 258 (735)
T ss_pred eeEEeccCce
Confidence 4666665443
No 113
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.83 E-value=1.7e-19 Score=144.83 Aligned_cols=221 Identities=15% Similarity=0.202 Sum_probs=162.9
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC-----
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS----- 174 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~----- 174 (350)
..|+.++-......+.+++.|.+.+||.++. +.++..+ .+|.+.|++++|++.+..+++++.|++.+||...
T Consensus 149 DGiW~Vaa~~tqpi~gtASADhTA~iWs~Es--g~CL~~Y-~GH~GSVNsikfh~s~~L~lTaSGD~taHIW~~av~~~v 225 (481)
T KOG0300|consen 149 DGIWHVAADSTQPICGTASADHTARIWSLES--GACLATY-TGHTGSVNSIKFHNSGLLLLTASGDETAHIWKAAVNWEV 225 (481)
T ss_pred cceeeehhhcCCcceeecccccceeEEeecc--ccceeee-cccccceeeEEeccccceEEEccCCcchHHHHHhhcCcC
Confidence 3678887777777899999999999999965 8887777 4899999999999998888888889999999843
Q ss_pred -CCCCCceeecc-------cccccceecCCCCC-ce-EEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC
Q 018806 175 -YPGNAASVRSG-------AASFLGALSRGPGT-RW-TLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 175 -~~~~~~~~~~~-------~~~~~~~~~~~~~~-~~-~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~ 244 (350)
.+..+...... .......-....++ .+ ..+..+.+|. +.|.+..|-..|+.+++++.|. +..+||+++
T Consensus 226 P~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~ltgH~-~vV~a~dWL~gg~Q~vTaSWDR-TAnlwDVEt 303 (481)
T KOG0300|consen 226 PSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRLTGHR-AVVSACDWLAGGQQMVTASWDR-TANLWDVET 303 (481)
T ss_pred CCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeeeeccc-cceEehhhhcCcceeeeeeccc-cceeeeecc
Confidence 11111100000 00000000111111 12 2345678886 7899999999999999999995 999999999
Q ss_pred CCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEE
Q 018806 245 GLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLG 321 (350)
Q Consensus 245 ~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~ 321 (350)
++... +.+|....+.++-+|..+++++.+.|.+.++||++..-. ..+.+|...|+++.|.-+.+. ++++++ ..+.
T Consensus 304 ge~v~~LtGHd~ELtHcstHptQrLVvTsSrDtTFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd~v-VSgSDD-rTvK 381 (481)
T KOG0300|consen 304 GEVVNILTGHDSELTHCSTHPTQRLVVTSSRDTTFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDDRV-VSGSDD-RTVK 381 (481)
T ss_pred CceeccccCcchhccccccCCcceEEEEeccCceeEeccchhhcceeeeecccccceeEEEEecCCce-eecCCC-ceEE
Confidence 98775 557889999999999999999999999999999984322 457799999999999987664 445433 2444
Q ss_pred EEEeCC
Q 018806 322 SIHFAS 327 (350)
Q Consensus 322 ~~~~~~ 327 (350)
.|++.+
T Consensus 382 vWdLrN 387 (481)
T KOG0300|consen 382 VWDLRN 387 (481)
T ss_pred Eeeecc
Confidence 444443
No 114
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.83 E-value=1.7e-18 Score=138.47 Aligned_cols=195 Identities=18% Similarity=0.305 Sum_probs=128.9
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEec-CCCCCCeeEEEEee-C-CCeEEEEecCCcEEEEecCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILT-SDSQRDVKVLEWRP-N-GGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~-~~~~~~v~~~~~sp-~-~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
-|+++.|.+.|+++|+|+.|++++|||.+..++...+.-. ..|.+.|..+.|.+ . |+.+++++.|+++.||.-....
T Consensus 15 lihdVs~D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS~Drtv~iWEE~~~~ 94 (361)
T KOG2445|consen 15 LIHDVSFDFYGRRMATCSSDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCSYDRTVSIWEEQEKS 94 (361)
T ss_pred eeeeeeecccCceeeeccCCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecCccccceEEEEecCCceeeeeecccc
Confidence 3899999999999999999999999998665555433321 36999999999954 3 6667777889999999763111
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEEEEeCCCeEEE----------------
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLASASYESSSFTI---------------- 239 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~g~i~i---------------- 239 (350)
... ....|....++.... +.|+++.|.|. |-.+++++.| |.++|
T Consensus 95 ~~~----------------~~~~Wv~~ttl~Dsr-ssV~DV~FaP~hlGLklA~~~aD-G~lRIYEA~dp~nLs~W~Lq~ 156 (361)
T KOG2445|consen 95 EEA----------------HGRRWVRRTTLVDSR-SSVTDVKFAPKHLGLKLAAASAD-GILRIYEAPDPMNLSQWTLQH 156 (361)
T ss_pred ccc----------------ccceeEEEEEeecCC-cceeEEEecchhcceEEEEeccC-cEEEEEecCCccccccchhhh
Confidence 000 011233333333332 34444444442 3334444444 34444
Q ss_pred -----------------------------------------------EeCCCCC--c---eeeeecCCCeEEEEEcCC-C
Q 018806 240 -----------------------------------------------WDVAQGL--G---TPIRRGFGGLSILKWSPT-G 266 (350)
Q Consensus 240 -----------------------------------------------wd~~~~~--~---~~~~~~~~~v~~~~~sp~-g 266 (350)
|....+. . ..+..+..+|+.++|.|+ |
T Consensus 157 Ei~~~~~pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~G 236 (361)
T KOG2445|consen 157 EIQNVIDPPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIG 236 (361)
T ss_pred hhhhccCCcccccCcceEEeeccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccC
Confidence 4433322 1 123356778999999996 3
Q ss_pred ---CEEEEEecCCeEEEEeCCCCc---------------------eeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 267 ---DYFFAAKFDGTFYLWETNTWT---------------------SEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 267 ---~~l~~~~~d~~v~iwd~~~~~---------------------~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
..||+++.|| |+||+++... ...+..|.+.|+.+.|+-.|..|++++
T Consensus 237 r~y~~lAvA~kDg-v~I~~v~~~~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wNmtGtiLsStG 307 (361)
T KOG2445|consen 237 RSYHLLAVATKDG-VRIFKVKVARSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWNMTGTILSSTG 307 (361)
T ss_pred CceeeEEEeecCc-EEEEEEeeccchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEeeeeeEEeecC
Confidence 4689999999 9999987411 012447899999999999999998775
No 115
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.83 E-value=9.5e-19 Score=137.31 Aligned_cols=215 Identities=15% Similarity=0.135 Sum_probs=161.3
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCcc-----------------------CeeEEEEecCCCEEEEEEC-----CCeEE
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEV-----------------------DLQGVSWHQHKHIVAFISG-----STQVI 124 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~-----------------------~V~~v~~sp~g~~la~~s~-----d~~i~ 124 (350)
.+.++.||.+.+++....-....++.+. +|..+.|+++|++++.... .+.|.
T Consensus 44 rlGty~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~ 123 (327)
T KOG0643|consen 44 RLGTYDGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVS 123 (327)
T ss_pred eeeeecCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEE
Confidence 4678999999887766555544444432 6888888888887776543 46777
Q ss_pred EEEccCCC----CCc-eeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCC
Q 018806 125 VRDYEDSE----GKD-ACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGT 199 (350)
Q Consensus 125 iw~~~~~~----~~~-~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~ 199 (350)
++|+.... .+. ...+ ..+...++.+-|.|-++.++++..+|.|.+||++.+..
T Consensus 124 ~fdi~~~~~~~~s~ep~~kI-~t~~skit~a~Wg~l~~~ii~Ghe~G~is~~da~~g~~--------------------- 181 (327)
T KOG0643|consen 124 VFDIRDDSSDIDSEEPYLKI-PTPDSKITSALWGPLGETIIAGHEDGSISIYDARTGKE--------------------- 181 (327)
T ss_pred EEEccCChhhhcccCceEEe-cCCccceeeeeecccCCEEEEecCCCcEEEEEcccCce---------------------
Confidence 88876322 222 2333 35678899999999999999998999999999985433
Q ss_pred ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCC--e
Q 018806 200 RWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDG--T 277 (350)
Q Consensus 200 ~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--~ 277 (350)
+++..+.|. ..|+++.++||..++++++.|. +-++||..+-+.........++.+.+++|.-.+++.|+.-. .
T Consensus 182 ---~v~s~~~h~-~~Ind~q~s~d~T~FiT~s~Dt-takl~D~~tl~v~Kty~te~PvN~aaisP~~d~VilgGGqeA~d 256 (327)
T KOG0643|consen 182 ---LVDSDEEHS-SKINDLQFSRDRTYFITGSKDT-TAKLVDVRTLEVLKTYTTERPVNTAAISPLLDHVILGGGQEAMD 256 (327)
T ss_pred ---eeechhhhc-cccccccccCCcceEEecccCc-cceeeeccceeeEEEeeecccccceecccccceEEecCCceeee
Confidence 234445565 6999999999999999999996 99999999998888888889999999999888877665332 3
Q ss_pred EEEEeCCCCce-------------eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 278 FYLWETNTWTS-------------EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 278 v~iwd~~~~~~-------------~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
|.--+.+.++. -...+|-++|++++|+|+|+..++|+
T Consensus 257 VTTT~~r~GKFEArFyh~i~eEEigrvkGHFGPINsvAfhPdGksYsSGG 306 (327)
T KOG0643|consen 257 VTTTSTRAGKFEARFYHLIFEEEIGRVKGHFGPINSVAFHPDGKSYSSGG 306 (327)
T ss_pred eeeecccccchhhhHHHHHHHHHhccccccccCcceeEECCCCcccccCC
Confidence 33333344432 23458999999999999999988775
No 116
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.83 E-value=1.7e-19 Score=152.71 Aligned_cols=218 Identities=16% Similarity=0.168 Sum_probs=167.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.-.|++......++++|+..+.|+|||+. .+.......+|...|+++.++..+.++++++..|.|.|..+.++....
T Consensus 81 ~~~Cv~~~s~S~y~~sgG~~~~Vkiwdl~---~kl~hr~lkdh~stvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt 157 (673)
T KOG4378|consen 81 NAFCVACASQSLYEISGGQSGCVKIWDLR---AKLIHRFLKDHQSTVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTT 157 (673)
T ss_pred hHHHHhhhhcceeeeccCcCceeeehhhH---HHHHhhhccCCcceeEEEEecCCcceeEEeccCCcEEEEecccCcccc
Confidence 34455555555899999999999999995 455566667899999999999887788777777999999988665543
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee--eeecCCCeE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP--IRRGFGGLS 258 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~--~~~~~~~v~ 258 (350)
.+... .+..|.-+.|+|..++++....|+|.|.+||+....... ...|..+..
T Consensus 158 ~f~~~-------------------------sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~ 212 (673)
T KOG4378|consen 158 TFTID-------------------------SGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSPIFHASEAHSAPCR 212 (673)
T ss_pred ceecC-------------------------CCCeEEEeecccccceeeEeeccCCeEEEEeccCCCcccchhhhccCCcC
Confidence 33222 234667899999988877666666999999998776543 445788899
Q ss_pred EEEEcCCC-CEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCC-CCcee
Q 018806 259 ILKWSPTG-DYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPP-SLDAH 335 (350)
Q Consensus 259 ~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~-~~~~~ 335 (350)
.+||+|.. .+|++.+.|..|.+||....+.........+.+.++|+++|.+|++|. .+.+.-|+++....|. .+.+|
T Consensus 213 gicfspsne~l~vsVG~Dkki~~yD~~s~~s~~~l~y~~Plstvaf~~~G~~L~aG~s~G~~i~YD~R~~k~Pv~v~sah 292 (673)
T KOG4378|consen 213 GICFSPSNEALLVSVGYDKKINIYDIRSQASTDRLTYSHPLSTVAFSECGTYLCAGNSKGELIAYDMRSTKAPVAVRSAH 292 (673)
T ss_pred cceecCCccceEEEecccceEEEeecccccccceeeecCCcceeeecCCceEEEeecCCceEEEEecccCCCCceEeeec
Confidence 99999965 456888999999999999877765566678899999999999999887 4445555555554444 66788
Q ss_pred ecccccceeec
Q 018806 336 LLPVDLPDIVS 346 (350)
Q Consensus 336 ~~~v~~~~~~~ 346 (350)
...|+...|..
T Consensus 293 ~~sVt~vafq~ 303 (673)
T KOG4378|consen 293 DASVTRVAFQP 303 (673)
T ss_pred ccceeEEEeee
Confidence 88888777654
No 117
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.83 E-value=1e-18 Score=158.01 Aligned_cols=212 Identities=20% Similarity=0.315 Sum_probs=156.2
Q ss_pred hhhhhhhccccccCCC--CcCCCC--ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE
Q 018806 77 LHGIISHSIKPLLHPD--HVHLLP--EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW 152 (350)
Q Consensus 77 ~~gh~~~~~~~~~~p~--~~~~~~--~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~ 152 (350)
+.|.....+.+.-+|. ...++. ..++++++|+-+|+++|.|+.|-.|++-+..+ ......+ .+|+++|.++.|
T Consensus 70 ~~~s~~~tv~~y~fps~~~~~iL~Rftlp~r~~~v~g~g~~iaagsdD~~vK~~~~~D--~s~~~~l-rgh~apVl~l~~ 146 (933)
T KOG1274|consen 70 LTGSEQNTVLRYKFPSGEEDTILARFTLPIRDLAVSGSGKMIAAGSDDTAVKLLNLDD--SSQEKVL-RGHDAPVLQLSY 146 (933)
T ss_pred EEeeccceEEEeeCCCCCccceeeeeeccceEEEEecCCcEEEeecCceeEEEEeccc--cchheee-cccCCceeeeeE
Confidence 3333344444555554 222343 46899999999999999999999999999865 3333444 589999999999
Q ss_pred eeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe
Q 018806 153 RPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY 232 (350)
Q Consensus 153 sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~ 232 (350)
+|++..|++++.||.|++|++..+.....+... ...........+..++|+|+|..++....
T Consensus 147 ~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v------------------~k~n~~~~s~i~~~~aW~Pk~g~la~~~~ 208 (933)
T KOG1274|consen 147 DPKGNFLAVSSCDGKVQIWDLQDGILSKTLTGV------------------DKDNEFILSRICTRLAWHPKGGTLAVPPV 208 (933)
T ss_pred cCCCCEEEEEecCceEEEEEcccchhhhhcccC------------------CccccccccceeeeeeecCCCCeEEeecc
Confidence 999888888888999999999844333222111 00001111246778999999888888888
Q ss_pred CCCeEEEEeCCCCCceeeee---cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCE
Q 018806 233 ESSSFTIWDVAQGLGTPIRR---GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRM 309 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~~~~---~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~ 309 (350)
| +.|++|+..+........ +...+..+.|+|+|+|||+++.||.|-|||.++-+. ......|.+++|.|++.-
T Consensus 209 d-~~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~wsPnG~YiAAs~~~g~I~vWnv~t~~~---~~~~~~Vc~~aw~p~~n~ 284 (933)
T KOG1274|consen 209 D-NTVKVYSRKGWELQFKLRDKLSSSKFSDLQWSPNGKYIAASTLDGQILVWNVDTHER---HEFKRAVCCEAWKPNANA 284 (933)
T ss_pred C-CeEEEEccCCceeheeecccccccceEEEEEcCCCcEEeeeccCCcEEEEecccchh---ccccceeEEEecCCCCCe
Confidence 8 499999999887654332 334589999999999999999999999999998333 334567999999999887
Q ss_pred EEEE
Q 018806 310 ILLA 313 (350)
Q Consensus 310 l~~~ 313 (350)
|-+.
T Consensus 285 it~~ 288 (933)
T KOG1274|consen 285 ITLI 288 (933)
T ss_pred eEEE
Confidence 7654
No 118
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.82 E-value=1.6e-20 Score=165.44 Aligned_cols=202 Identities=14% Similarity=0.232 Sum_probs=160.9
Q ss_pred CcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEe
Q 018806 93 HVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWA 172 (350)
Q Consensus 93 ~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd 172 (350)
.....+...|.++..-..++.+++|+.|..+.+|.+.. ......+ .+|..+|.++.|+++...++++..+|+|++||
T Consensus 22 ~~~~~hsaav~~lk~~~s~r~~~~Gg~~~k~~L~~i~k--p~~i~S~-~~hespIeSl~f~~~E~LlaagsasgtiK~wD 98 (825)
T KOG0267|consen 22 REFVAHSAAVGCLKIRKSSRSLVTGGEDEKVNLWAIGK--PNAITSL-TGHESPIESLTFDTSERLLAAGSASGTIKVWD 98 (825)
T ss_pred hhhhhhhhhhceeeeeccceeeccCCCceeeccccccC--Cchhhee-eccCCcceeeecCcchhhhcccccCCceeeee
Confidence 34445555677777766788999999999999999853 2223333 58999999999999955555555589999999
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR- 251 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~- 251 (350)
++... .++++.+|. ..+.++.|+|-+.+.+.++.| +.+++||++...+...+
T Consensus 99 leeAk-------------------------~vrtLtgh~-~~~~sv~f~P~~~~~a~gStd-td~~iwD~Rk~Gc~~~~~ 151 (825)
T KOG0267|consen 99 LEEAK-------------------------IVRTLTGHL-LNITSVDFHPYGEFFASGSTD-TDLKIWDIRKKGCSHTYK 151 (825)
T ss_pred hhhhh-------------------------hhhhhhccc-cCcceeeeccceEEecccccc-ccceehhhhccCceeeec
Confidence 98332 244577886 689999999999999999999 69999999976666544
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
.|...+..++|+|+|++++.+++|.+++|||...|+.. .+..|++.+..+.|+|..-+++.|+ +....+|++.
T Consensus 152 s~~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~agk~~~ef~~~e~~v~sle~hp~e~Lla~Gs~d~tv~f~dle 226 (825)
T KOG0267|consen 152 SHTRVVDVLRLSPDGRWVASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPLEVLLAPGSSDRTVRFWDLE 226 (825)
T ss_pred CCcceeEEEeecCCCceeeccCCcceeeeecccccccccccccccccccccccCchhhhhccCCCCceeeeeccc
Confidence 46788999999999999999999999999999999985 5667999999999999888888775 4444555544
No 119
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.82 E-value=1.1e-18 Score=154.02 Aligned_cols=222 Identities=12% Similarity=0.142 Sum_probs=167.0
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC--C-CeEEEEecCCcEEEEecCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN--G-GRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--~-~~l~~~~~d~~v~iwd~~~~ 176 (350)
..+++++.||+|++||+|..-|+++||++.. -...+.+ ..|+..|.++.++.- + +.|++++.|+-|+|||+...
T Consensus 460 ~G~R~~~vSp~gqhLAsGDr~GnlrVy~Lq~--l~~~~~~-eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rn 536 (1080)
T KOG1408|consen 460 FGFRALAVSPDGQHLASGDRGGNLRVYDLQE--LEYTCFM-EAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRN 536 (1080)
T ss_pred cceEEEEECCCcceecccCccCceEEEEehh--hhhhhhe-ecccceeEEEeecCchhhhHhhhhccCCceEEEEecccc
Confidence 4799999999999999999999999999953 3443444 479999999999843 2 34555666899999999744
Q ss_pred CCCceeecccccccceecCCCC-----------CceEEeeecc---------CCC----CCceeeEEECCCCCeEEEEEe
Q 018806 177 GNAASVRSGAASFLGALSRGPG-----------TRWTLVDFLR---------SQN----GEQITALSWGPDGRYLASASY 232 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~-----------~~~~~~~~~~---------~~~----~~~v~~~~~sp~g~~l~~~~~ 232 (350)
-.......++.+.+..+.+... ++..+.+..+ .|+ ...+++++..|..+++++++.
T Consensus 537 y~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQ 616 (1080)
T KOG1408|consen 537 YDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQ 616 (1080)
T ss_pred cchhhhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEec
Confidence 3333333333333333222211 1111122111 111 246789999999999999999
Q ss_pred CCCeEEEEeCCCCCceeeee----cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCC
Q 018806 233 ESSSFTIWDVAQGLGTPIRR----GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~~~~----~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g 307 (350)
|. .|+|||+.+++....+. |.+....+...|.|-|||+...|+++.++|+-++++ .+..+|...|+.+.|.+|.
T Consensus 617 Dr-nirif~i~sgKq~k~FKgs~~~eG~lIKv~lDPSgiY~atScsdktl~~~Df~sgEcvA~m~GHsE~VTG~kF~nDC 695 (1080)
T KOG1408|consen 617 DR-NIRIFDIESGKQVKSFKGSRDHEGDLIKVILDPSGIYLATSCSDKTLCFVDFVSGECVAQMTGHSEAVTGVKFLNDC 695 (1080)
T ss_pred cc-ceEEEeccccceeeeecccccCCCceEEEEECCCccEEEEeecCCceEEEEeccchhhhhhcCcchheeeeeecccc
Confidence 95 99999999998876553 457788899999999999999999999999999998 5788999999999999999
Q ss_pred CEEEEEECCCeEEEEEEeC
Q 018806 308 RMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 308 ~~l~~~~~~~~~~~~~~~~ 326 (350)
+.|++.+ ++..|+.|++.
T Consensus 696 kHlISvs-gDgCIFvW~lp 713 (1080)
T KOG1408|consen 696 KHLISVS-GDGCIFVWKLP 713 (1080)
T ss_pred hhheeec-CCceEEEEECc
Confidence 9998765 33467777665
No 120
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.82 E-value=1.9e-17 Score=127.11 Aligned_cols=222 Identities=16% Similarity=0.200 Sum_probs=154.5
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCce--eEecCCCCCCeeEEEEeeC---CCeEEEEecC--CcEEEE
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDA--CILTSDSQRDVKVLEWRPN---GGRSLSVGCK--GGICIW 171 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~--~~~~~~~~~~v~~~~~sp~---~~~l~~~~~d--~~v~iw 171 (350)
...|+|.+|||+|++||+|++|++|++..++..+.+.. ...+.-|++.|..++|-.+ +..+++++.. .+|++-
T Consensus 89 kgsiyc~~ws~~geliatgsndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~gagdc~iy~t 168 (350)
T KOG0641|consen 89 KGSIYCTAWSPCGELIATGSNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAGAGDCKIYIT 168 (350)
T ss_pred CccEEEEEecCccCeEEecCCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecCCCcceEEEe
Confidence 45799999999999999999999999998864332211 1112358999999999643 4456665554 455555
Q ss_pred ecCCCCCCceeecccccccc---------eecCCCCCceEEee--------eccC------CCCCceeeEEECCCCCeEE
Q 018806 172 APSYPGNAASVRSGAASFLG---------ALSRGPGTRWTLVD--------FLRS------QNGEQITALSWGPDGRYLA 228 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~---------~~~~~~~~~~~~~~--------~~~~------~~~~~v~~~~~sp~g~~l~ 228 (350)
|...++... ...+....+. -.+.+++..++.|+ ++.. -..+.|.+++..|.|+.|+
T Consensus 169 dc~~g~~~~-a~sghtghilalyswn~~m~~sgsqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~ 247 (350)
T KOG0641|consen 169 DCGRGQGFH-ALSGHTGHILALYSWNGAMFASGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLA 247 (350)
T ss_pred ecCCCCcce-eecCCcccEEEEEEecCcEEEccCCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceee
Confidence 554332222 2222221111 12334455555443 2211 1125789999999999999
Q ss_pred EEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-----ccccCCCCeEEEE
Q 018806 229 SASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-----PWSSTSGFVTGAT 302 (350)
Q Consensus 229 ~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-----~~~~~~~~v~~~~ 302 (350)
++..|+ ...+||++.+...+ +..|...|.++.|+|...++++++.|..|++-|+...-.. ....|...+..+.
T Consensus 248 sg~~ds-sc~lydirg~r~iq~f~phsadir~vrfsp~a~yllt~syd~~ikltdlqgdla~el~~~vv~ehkdk~i~~r 326 (350)
T KOG0641|consen 248 SGHADS-SCMLYDIRGGRMIQRFHPHSADIRCVRFSPGAHYLLTCSYDMKIKLTDLQGDLAHELPIMVVAEHKDKAIQCR 326 (350)
T ss_pred eccCCC-ceEEEEeeCCceeeeeCCCccceeEEEeCCCceEEEEecccceEEEeecccchhhcCceEEEEeccCceEEEE
Confidence 999996 99999999988665 5568889999999999999999999999999999754322 2347888999999
Q ss_pred EcCCCCEEEEEE-CCCeEEEE
Q 018806 303 WDPEGRMILLAF-AGSLTLGS 322 (350)
Q Consensus 303 ~s~~g~~l~~~~-~~~~~~~~ 322 (350)
|+|..-.+++++ ++...+|.
T Consensus 327 wh~~d~sfisssadkt~tlwa 347 (350)
T KOG0641|consen 327 WHPQDFSFISSSADKTATLWA 347 (350)
T ss_pred ecCccceeeeccCcceEEEec
Confidence 999887766654 55455443
No 121
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.82 E-value=8.7e-19 Score=140.83 Aligned_cols=213 Identities=14% Similarity=0.234 Sum_probs=163.4
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEcc----CCC------------------------------C----CceeEecCCC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYE----DSE------------------------------G----KDACILTSDS 143 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~----~~~------------------------------~----~~~~~~~~~~ 143 (350)
|+++.|++.+.++++++.|++.+||... .+. + ..+..+ .+|
T Consensus 193 VNsikfh~s~~L~lTaSGD~taHIW~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~l-tgH 271 (481)
T KOG0300|consen 193 VNSIKFHNSGLLLLTASGDETAHIWKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRL-TGH 271 (481)
T ss_pred eeeEEeccccceEEEccCCcchHHHHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeee-ecc
Confidence 9999999999999999999999999721 000 0 011122 478
Q ss_pred CCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC
Q 018806 144 QRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD 223 (350)
Q Consensus 144 ~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 223 (350)
...|.+..|-..|+++++++.|.+..+||++++. +++.+.||. ...+.++-+|.
T Consensus 272 ~~vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtge-------------------------~v~~LtGHd-~ELtHcstHpt 325 (481)
T KOG0300|consen 272 RAVVSACDWLAGGQQMVTASWDRTANLWDVETGE-------------------------VVNILTGHD-SELTHCSTHPT 325 (481)
T ss_pred ccceEehhhhcCcceeeeeeccccceeeeeccCc-------------------------eeccccCcc-hhccccccCCc
Confidence 8899999999999999999999999999999544 355577885 68899999999
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCc--eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEE
Q 018806 224 GRYLASASYESSSFTIWDVAQGLG--TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTG 300 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~ 300 (350)
.+.+++++.|. +.++||++..-. ..+++|...|++..|..+. .+++|+.|.+|+|||+++... ........++..
T Consensus 326 QrLVvTsSrDt-TFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd-~vVSgSDDrTvKvWdLrNMRsplATIRtdS~~NR 403 (481)
T KOG0300|consen 326 QRLVVTSSRDT-TFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDD-RVVSGSDDRTVKVWDLRNMRSPLATIRTDSPANR 403 (481)
T ss_pred ceEEEEeccCc-eeEeccchhhcceeeeecccccceeEEEEecCC-ceeecCCCceEEEeeeccccCcceeeecCCccce
Confidence 99999999995 999999995432 3466788999999999776 488999999999999998765 445566788999
Q ss_pred EEEcCCCCEEEEEECCCeEEEEEEeCCCC----C--CCceeeccccccee
Q 018806 301 ATWDPEGRMILLAFAGSLTLGSIHFASKP----P--SLDAHLLPVDLPDI 344 (350)
Q Consensus 301 ~~~s~~g~~l~~~~~~~~~~~~~~~~~~~----~--~~~~~~~~v~~~~~ 344 (350)
++.+..++.|+.-.++. .+..+++.+.. | .-.+|..-|.+..+
T Consensus 404 vavs~g~~iIAiPhDNR-qvRlfDlnG~RlaRlPrtsRqgHrRMV~c~AW 452 (481)
T KOG0300|consen 404 VAVSKGHPIIAIPHDNR-QVRLFDLNGNRLARLPRTSRQGHRRMVTCCAW 452 (481)
T ss_pred eEeecCCceEEeccCCc-eEEEEecCCCccccCCcccccccceeeeeeec
Confidence 99999888888877654 45555554331 1 33466555554433
No 122
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.81 E-value=4.9e-18 Score=153.46 Aligned_cols=205 Identities=18% Similarity=0.228 Sum_probs=162.8
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...+.+..|+ ..++++++.+.+|++|+.. ++.....-..+|.+.|+++++..-+..+++++.|.++++||...+.
T Consensus 208 ~~~~~~~q~~--~~~~~~~s~~~tl~~~~~~--~~~~i~~~l~GH~g~V~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~- 282 (537)
T KOG0274|consen 208 DHVVLCLQLH--DGFFKSGSDDSTLHLWDLN--NGYLILTRLVGHFGGVWGLAFPSGGDKLVSGSTDKTERVWDCSTGE- 282 (537)
T ss_pred cchhhhheee--cCeEEecCCCceeEEeecc--cceEEEeeccCCCCCceeEEEecCCCEEEEEecCCcEEeEecCCCc-
Confidence 3467888888 5678899999999999985 3666666457999999999997655678888889999999988554
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee-cCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR-GFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~-~~~~v 257 (350)
+...+.+|. +.+.++...+ ..+++++.|. +|++|++.++....+.. |..+|
T Consensus 283 ------------------------C~~~l~gh~-stv~~~~~~~--~~~~sgs~D~-tVkVW~v~n~~~l~l~~~h~~~V 334 (537)
T KOG0274|consen 283 ------------------------CTHSLQGHT-SSVRCLTIDP--FLLVSGSRDN-TVKVWDVTNGACLNLLRGHTGPV 334 (537)
T ss_pred ------------------------EEEEecCCC-ceEEEEEccC--ceEeeccCCc-eEEEEeccCcceEEEeccccccE
Confidence 355677776 6888887653 5677788996 99999999999888776 89999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeC-CCCCCCce
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFA-SKPPSLDA 334 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~-~~~~~~~~ 334 (350)
.++..+ +.++++|+.|++|++||+.++++ ..+.+|...|.++.+... ..++.|+ ++.+.+|++... ....++.+
T Consensus 335 ~~v~~~--~~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~V~sl~~~~~-~~~~Sgs~D~~IkvWdl~~~~~c~~tl~~ 411 (537)
T KOG0274|consen 335 NCVQLD--EPLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGRVYSLIVDSE-NRLLSGSLDTTIKVWDLRTKRKCIHTLQG 411 (537)
T ss_pred EEEEec--CCEEEEEecCceEEEEEhhhceeeeeecCCcceEEEEEecCc-ceEEeeeeccceEeecCCchhhhhhhhcC
Confidence 999997 78999999999999999999998 568899999999988876 7777776 544444444444 33446777
Q ss_pred eeccc
Q 018806 335 HLLPV 339 (350)
Q Consensus 335 ~~~~v 339 (350)
|..-+
T Consensus 412 h~~~v 416 (537)
T KOG0274|consen 412 HTSLV 416 (537)
T ss_pred Ccccc
Confidence 76655
No 123
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.80 E-value=4.9e-18 Score=142.61 Aligned_cols=204 Identities=13% Similarity=0.137 Sum_probs=165.1
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCC-ce-------------eEec-CCCCCCeeEEEEeeCCCeEEEE
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGK-DA-------------CILT-SDSQRDVKVLEWRPNGGRSLSV 162 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~-~~-------------~~~~-~~~~~~v~~~~~sp~~~~l~~~ 162 (350)
+...|.+++++|+.+++++++.+++|.=|++.+.... .+ .... ..|...+.+++.++||++++++
T Consensus 141 H~~s~~~vals~d~~~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~avS~Dgkylatg 220 (479)
T KOG0299|consen 141 HQLSVTSVALSPDDKRVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAVSSDGKYLATG 220 (479)
T ss_pred ccCcceEEEeeccccceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEEcCCCcEEEec
Confidence 3568999999999999999999999999998642211 00 0111 2677889999999999999999
Q ss_pred ecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeC
Q 018806 163 GCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDV 242 (350)
Q Consensus 163 ~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~ 242 (350)
+.|..|.||+..+... .+.+.+|. +.|.+++|-.....+++++.| ..|++|++
T Consensus 221 g~d~~v~Iw~~~t~eh-------------------------v~~~~ghr-~~V~~L~fr~gt~~lys~s~D-rsvkvw~~ 273 (479)
T KOG0299|consen 221 GRDRHVQIWDCDTLEH-------------------------VKVFKGHR-GAVSSLAFRKGTSELYSASAD-RSVKVWSI 273 (479)
T ss_pred CCCceEEEecCcccch-------------------------hhcccccc-cceeeeeeecCccceeeeecC-CceEEEeh
Confidence 9999999999985544 34467776 799999998888899999999 59999999
Q ss_pred CCCCce-eeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEE
Q 018806 243 AQGLGT-PIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLG 321 (350)
Q Consensus 243 ~~~~~~-~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~ 321 (350)
+..... .+++|+..|..+.-..-++.+.+|+.|+++++|++.......+.++.+.+.+++|-.+. .+++|+++ ..|+
T Consensus 274 ~~~s~vetlyGHqd~v~~IdaL~reR~vtVGgrDrT~rlwKi~eesqlifrg~~~sidcv~~In~~-HfvsGSdn-G~Ia 351 (479)
T KOG0299|consen 274 DQLSYVETLYGHQDGVLGIDALSRERCVTVGGRDRTVRLWKIPEESQLIFRGGEGSIDCVAFINDE-HFVSGSDN-GSIA 351 (479)
T ss_pred hHhHHHHHHhCCccceeeechhcccceEEeccccceeEEEeccccceeeeeCCCCCeeeEEEeccc-ceeeccCC-ceEE
Confidence 876654 57889999999988888888888889999999999766667777888899999998765 45556644 4788
Q ss_pred EEEeCCCCC
Q 018806 322 SIHFASKPP 330 (350)
Q Consensus 322 ~~~~~~~~~ 330 (350)
.|.++.+.+
T Consensus 352 LWs~~KKkp 360 (479)
T KOG0299|consen 352 LWSLLKKKP 360 (479)
T ss_pred EeeecccCc
Confidence 888888776
No 124
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.80 E-value=2.2e-18 Score=141.34 Aligned_cols=188 Identities=18% Similarity=0.310 Sum_probs=135.2
Q ss_pred CeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCe-EEEEecCCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGR-SLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~~~~d~~v~iwd~~~~~~ 178 (350)
.=+++.|||-. ..|++|.--+.|++|...+...+.-..-+.+|...|-.++|||.... |++++.|++|+|||++...+
T Consensus 213 EGy~LdWSp~~~g~LlsGDc~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs~~~ 292 (440)
T KOG0302|consen 213 EGYGLDWSPIKTGRLLSGDCVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRSGPK 292 (440)
T ss_pred cceeeecccccccccccCccccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecCCCc
Confidence 34788999933 34778877888999998654333223334479999999999997554 55566699999999996544
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce----eeeecC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT----PIRRGF 254 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~----~~~~~~ 254 (350)
...+. .+.| ++.|.-+.|+.+-.+|++|+.| |+++|||++.-+.. .+..|.
T Consensus 293 ~~~~~-----------------------~kAh-~sDVNVISWnr~~~lLasG~Dd-Gt~~iwDLR~~~~~~pVA~fk~Hk 347 (440)
T KOG0302|consen 293 KAAVS-----------------------TKAH-NSDVNVISWNRREPLLASGGDD-GTLSIWDLRQFKSGQPVATFKYHK 347 (440)
T ss_pred cceeE-----------------------eecc-CCceeeEEccCCcceeeecCCC-ceEEEEEhhhccCCCcceeEEecc
Confidence 32221 1445 4799999999988888888877 89999999975433 466789
Q ss_pred CCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCce---------e--------ccccC--CCCeEEEEEcCCCCEEEEE
Q 018806 255 GGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTS---------E--------PWSST--SGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 255 ~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~---------~--------~~~~~--~~~v~~~~~s~~g~~l~~~ 313 (350)
.+|+++.|+|. ...|++++.|..|.|||+....- . -++-| ...+-.+.|+++-.-++++
T Consensus 348 ~pItsieW~p~e~s~iaasg~D~QitiWDlsvE~D~ee~~~~a~~~L~dlPpQLLFVHqGQke~KevhWH~QiPG~lvs 426 (440)
T KOG0302|consen 348 APITSIEWHPHEDSVIAASGEDNQITIWDLSVEADEEEIDQEAAEGLQDLPPQLLFVHQGQKEVKEVHWHRQIPGLLVS 426 (440)
T ss_pred CCeeEEEeccccCceEEeccCCCcEEEEEeeccCChhhhccccccchhcCCceeEEEecchhHhhhheeccCCCCeEEE
Confidence 99999999995 45678889999999999854221 0 12223 3457778888875544444
No 125
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.79 E-value=5.5e-18 Score=148.97 Aligned_cols=222 Identities=18% Similarity=0.267 Sum_probs=159.6
Q ss_pred cCeeEEEEecCCC---EEEEEECCCeEEEEEccCCCCC----------------------cee------EecCCCCCCee
Q 018806 100 VDLQGVSWHQHKH---IVAFISGSTQVIVRDYEDSEGK----------------------DAC------ILTSDSQRDVK 148 (350)
Q Consensus 100 ~~V~~v~~sp~g~---~la~~s~d~~i~iw~~~~~~~~----------------------~~~------~~~~~~~~~v~ 148 (350)
..|++++|...+. +||++|+|..|+||.+...+.. .+. .+..+|+..|.
T Consensus 192 DWIrsl~f~~~~~~~~~laS~SQD~yIRiW~i~~~~~~~~~~~e~~~t~~~~~~~f~~l~~i~~~is~eall~GHeDWV~ 271 (764)
T KOG1063|consen 192 DWIRSLAFARLGGDDLLLASSSQDRYIRIWRIVLGDDEDSNEREDSLTTLSNLPVFMILEEIQYRISFEALLMGHEDWVY 271 (764)
T ss_pred hhhhhhhhhccCCCcEEEEecCCceEEEEEEEEecCCccccccccccccccCCceeeeeeeEEEEEehhhhhcCcccceE
Confidence 3588888876554 8899999999999987543200 001 22348999999
Q ss_pred EEEEeeCCCeEEEEecCCcEEEEecCCCCC--------------Cceeecccccccc--eecCCCCCceEEee-------
Q 018806 149 VLEWRPNGGRSLSVGCKGGICIWAPSYPGN--------------AASVRSGAASFLG--ALSRGPGTRWTLVD------- 205 (350)
Q Consensus 149 ~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~--------------~~~~~~~~~~~~~--~~~~~~~~~~~~~~------- 205 (350)
++.|+|.+..|++++.|+++.+|....... ..-+..+.+.+.. -++.+..+.|.+|+
T Consensus 272 sv~W~p~~~~LLSASaDksmiiW~pd~~tGiWv~~vRlGe~gg~a~GF~g~lw~~n~~~ii~~g~~Gg~hlWkt~d~~~w 351 (764)
T KOG1063|consen 272 SVWWHPEGLDLLSASADKSMIIWKPDENTGIWVDVVRLGEVGGSAGGFWGGLWSPNSNVIIAHGRTGGFHLWKTKDKTFW 351 (764)
T ss_pred EEEEccchhhheecccCcceEEEecCCccceEEEEEEeecccccccceeeEEEcCCCCEEEEecccCcEEEEeccCccce
Confidence 999999988999999999999998763311 1111122222222 24444455555555
Q ss_pred ----eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC------------------------------------
Q 018806 206 ----FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG------------------------------------ 245 (350)
Q Consensus 206 ----~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~------------------------------------ 245 (350)
.+.||. ..|.+++|+|.|.+|++++.| .+-|+|-.-..
T Consensus 352 ~~~~~iSGH~-~~V~dv~W~psGeflLsvs~D-QTTRlFa~wg~q~~wHEiaRPQiHGyDl~c~~~vn~~~~FVSgAdEK 429 (764)
T KOG1063|consen 352 TQEPVISGHV-DGVKDVDWDPSGEFLLSVSLD-QTTRLFARWGRQQEWHEIARPQIHGYDLTCLSFVNEDLQFVSGADEK 429 (764)
T ss_pred eecccccccc-ccceeeeecCCCCEEEEeccc-cceeeecccccccceeeecccccccccceeeehccCCceeeecccce
Confidence 456786 699999999999999999998 47776532200
Q ss_pred --------------------------------------------------------------------------------
Q 018806 246 -------------------------------------------------------------------------------- 245 (350)
Q Consensus 246 -------------------------------------------------------------------------------- 245 (350)
T Consensus 430 VlRvF~aPk~fv~~l~~i~g~~~~~~~~~p~gA~VpaLGLSnKa~~~~e~~~G~~~~~~~et~~~~~p~~L~ePP~EdqL 509 (764)
T KOG1063|consen 430 VLRVFEAPKSFVKSLMAICGKCFKGSDELPDGANVPALGLSNKAFFPGETNTGGEAAVCAETPLAAAPCELTEPPTEDQL 509 (764)
T ss_pred eeeeecCcHHHHHHHHHHhCccccCchhcccccccccccccCCCCcccccccccccceeeecccccCchhccCCChHHHH
Confidence
Q ss_pred -------CceeeeecCCCeEEEEEcCCCCEEEEEecC-----CeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEE
Q 018806 246 -------LGTPIRRGFGGLSILKWSPTGDYFFAAKFD-----GTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILL 312 (350)
Q Consensus 246 -------~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d-----~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~ 312 (350)
+..++.+|...|++++.+|+|+++|+++.. ..|++|+..+.... .+..|.-.|+.++|||||++|++
T Consensus 510 q~~tLwPEv~KLYGHGyEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~HsLTVT~l~FSpdg~~LLs 589 (764)
T KOG1063|consen 510 QQNTLWPEVHKLYGHGYEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEGHSLTVTRLAFSPDGRYLLS 589 (764)
T ss_pred HHhccchhhHHhccCceeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecccceEEEEEEECCCCcEEEE
Confidence 112334566679999999999999988653 47999999988774 48899999999999999999999
Q ss_pred EE-CCCeEEEEE
Q 018806 313 AF-AGSLTLGSI 323 (350)
Q Consensus 313 ~~-~~~~~~~~~ 323 (350)
.+ |....+|..
T Consensus 590 vsRDRt~sl~~~ 601 (764)
T KOG1063|consen 590 VSRDRTVSLYEV 601 (764)
T ss_pred eecCceEEeeee
Confidence 86 444555554
No 126
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.79 E-value=7.3e-18 Score=145.95 Aligned_cols=239 Identities=17% Similarity=0.251 Sum_probs=168.4
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCe-EEEEecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGR-SLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~~~~d~~v~iwd~~~~~~ 178 (350)
..|.+++.+|.|.+||+|+.||+++||.+.+ +.++..+. ..+.|.+++|+|.+.. +++++....+.|-+...+..
T Consensus 401 g~Vr~iSvdp~G~wlasGsdDGtvriWEi~T--gRcvr~~~--~d~~I~~vaw~P~~~~~vLAvA~~~~~~ivnp~~G~~ 476 (733)
T KOG0650|consen 401 GLVRSISVDPSGEWLASGSDDGTVRIWEIAT--GRCVRTVQ--FDSEIRSVAWNPLSDLCVLAVAVGECVLIVNPIFGDR 476 (733)
T ss_pred CeEEEEEecCCcceeeecCCCCcEEEEEeec--ceEEEEEe--ecceeEEEEecCCCCceeEEEEecCceEEeCccccch
Confidence 3699999999999999999999999999954 87777664 4668999999998654 55566666677777664422
Q ss_pred Cceeecc-----c---ccccce-ecCCCC---CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC--CeEEEEeCCC
Q 018806 179 AASVRSG-----A---ASFLGA-LSRGPG---TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES--SSFTIWDVAQ 244 (350)
Q Consensus 179 ~~~~~~~-----~---~~~~~~-~~~~~~---~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--g~i~iwd~~~ 244 (350)
...-.+. . ..+... ..+... ....-+...-.| ...|..+.|+..|.+|++...++ ..|.|.++..
T Consensus 477 ~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~-~k~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK 555 (733)
T KOG0650|consen 477 LEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKH-PKSIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSK 555 (733)
T ss_pred hhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEec-CCccceeeeecCCceEEEeccCCCcceEEEEeccc
Confidence 2111000 0 000000 111111 000011112223 47899999999999999886643 2788888876
Q ss_pred CCce-eeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEE
Q 018806 245 GLGT-PIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLG 321 (350)
Q Consensus 245 ~~~~-~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~ 321 (350)
...+ .+....+.+.++.|+|...+|++++ .+.|+|||+..+.. ..+......|.+|+.+|.|..|++++ ++....+
T Consensus 556 ~~sQ~PF~kskG~vq~v~FHPs~p~lfVaT-q~~vRiYdL~kqelvKkL~tg~kwiS~msihp~GDnli~gs~d~k~~Wf 634 (733)
T KOG0650|consen 556 RKSQSPFRKSKGLVQRVKFHPSKPYLFVAT-QRSVRIYDLSKQELVKKLLTGSKWISSMSIHPNGDNLILGSYDKKMCWF 634 (733)
T ss_pred ccccCchhhcCCceeEEEecCCCceEEEEe-ccceEEEehhHHHHHHHHhcCCeeeeeeeecCCCCeEEEecCCCeeEEE
Confidence 6543 4555678899999999999988876 46799999988665 45666777899999999999999887 7777888
Q ss_pred EEEeCCCCC-CCceeeccccccee
Q 018806 322 SIHFASKPP-SLDAHLLPVDLPDI 344 (350)
Q Consensus 322 ~~~~~~~~~-~~~~~~~~v~~~~~ 344 (350)
++++.+++. ++..|...++.-.+
T Consensus 635 DldlsskPyk~lr~H~~avr~Va~ 658 (733)
T KOG0650|consen 635 DLDLSSKPYKTLRLHEKAVRSVAF 658 (733)
T ss_pred EcccCcchhHHhhhhhhhhhhhhh
Confidence 888888775 66777777764433
No 127
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.79 E-value=3.3e-17 Score=131.75 Aligned_cols=202 Identities=14% Similarity=0.238 Sum_probs=135.3
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccce---------ecCCC--CCceE--------
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGA---------LSRGP--GTRWT-------- 202 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~---------~~~~~--~~~~~-------- 202 (350)
...+.|.++.|+++|..+++++.|..+++||...+.....+...+...... +..+. +..++
T Consensus 12 ~~~~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~skkyG~~~~~Fth~~~~~i~sStk~d~tIryLsl~dNk 91 (311)
T KOG1446|consen 12 ETNGKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINSKKYGVDLACFTHHSNTVIHSSTKEDDTIRYLSLHDNK 91 (311)
T ss_pred cCCCceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeecccccccEEEEecCCceEEEccCCCCCceEEEEeecCc
Confidence 356789999999999999998889999999999777777666553322211 11111 22332
Q ss_pred EeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee------------------------------
Q 018806 203 LVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR------------------------------ 252 (350)
Q Consensus 203 ~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~------------------------------ 252 (350)
.++.+.||. ..|.+++.+|-+..+++++.|+ +|++||++..++.-+..
T Consensus 92 ylRYF~GH~-~~V~sL~~sP~~d~FlS~S~D~-tvrLWDlR~~~cqg~l~~~~~pi~AfDp~GLifA~~~~~~~IkLyD~ 169 (311)
T KOG1446|consen 92 YLRYFPGHK-KRVNSLSVSPKDDTFLSSSLDK-TVRLWDLRVKKCQGLLNLSGRPIAAFDPEGLIFALANGSELIKLYDL 169 (311)
T ss_pred eEEEcCCCC-ceEEEEEecCCCCeEEecccCC-eEEeeEecCCCCceEEecCCCcceeECCCCcEEEEecCCCeEEEEEe
Confidence 556789997 7999999999999999999995 99999999653221111
Q ss_pred ----------------cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccC---CCCeEEEEEcCCCCEEEE
Q 018806 253 ----------------GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSST---SGFVTGATWDPEGRMILL 312 (350)
Q Consensus 253 ----------------~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~---~~~v~~~~~s~~g~~l~~ 312 (350)
.......+.|||||++|+.+...+.+++.|.-+|.... +..+ ..--.+..|+||++++++
T Consensus 170 Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~s~~~~lDAf~G~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~ 249 (311)
T KOG1446|consen 170 RSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNASFIYLLDAFDGTVKSTFSGYPNAGNLPLSATFTPDSKFVLS 249 (311)
T ss_pred cccCCCCceeEccCCCCccceeeeEEcCCCCEEEEEeCCCcEEEEEccCCcEeeeEeeccCCCCcceeEEECCCCcEEEE
Confidence 01234567788888888777777788888877777632 2222 112257889999999998
Q ss_pred EEC-CCeEEEEEEeCCCCCCCce-eecccccceee
Q 018806 313 AFA-GSLTLGSIHFASKPPSLDA-HLLPVDLPDIV 345 (350)
Q Consensus 313 ~~~-~~~~~~~~~~~~~~~~~~~-~~~~v~~~~~~ 345 (350)
|.+ +.+.+|.++...+...+.+ +..++....++
T Consensus 250 gs~dg~i~vw~~~tg~~v~~~~~~~~~~~~~~~fn 284 (311)
T KOG1446|consen 250 GSDDGTIHVWNLETGKKVAVLRGPNGGPVSCVRFN 284 (311)
T ss_pred ecCCCcEEEEEcCCCcEeeEecCCCCCCccccccC
Confidence 763 4455554433333223333 45555554443
No 128
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.79 E-value=1.6e-17 Score=146.03 Aligned_cols=248 Identities=19% Similarity=0.252 Sum_probs=172.2
Q ss_pred hhhhhhhhhhccccccCCCCcCCCCcc-------------------------------CeeEEEEecCCCEEEEEECCCe
Q 018806 74 FSTLHGIISHSIKPLLHPDHVHLLPEV-------------------------------DLQGVSWHQHKHIVAFISGSTQ 122 (350)
Q Consensus 74 ~~~~~gh~~~~~~~~~~p~~~~~~~~~-------------------------------~V~~v~~sp~g~~la~~s~d~~ 122 (350)
.+++.||.+-++...++|....++... ...+.-|+|+++.+++-+..|.
T Consensus 260 eall~GHeDWV~sv~W~p~~~~LLSASaDksmiiW~pd~~tGiWv~~vRlGe~gg~a~GF~g~lw~~n~~~ii~~g~~Gg 339 (764)
T KOG1063|consen 260 EALLMGHEDWVYSVWWHPEGLDLLSASADKSMIIWKPDENTGIWVDVVRLGEVGGSAGGFWGGLWSPNSNVIIAHGRTGG 339 (764)
T ss_pred hhhhcCcccceEEEEEccchhhheecccCcceEEEecCCccceEEEEEEeecccccccceeeEEEcCCCCEEEEecccCc
Confidence 477889999999888888875555432 2567789999998888888999
Q ss_pred EEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC--cee----------ecccccc-
Q 018806 123 VIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA--ASV----------RSGAASF- 189 (350)
Q Consensus 123 i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~--~~~----------~~~~~~~- 189 (350)
.++|.-..+..-.......+|.+.|.+++|+|.|+.|++++.|.+-|++--- +.+. ..+ ....+-.
T Consensus 340 ~hlWkt~d~~~w~~~~~iSGH~~~V~dv~W~psGeflLsvs~DQTTRlFa~w-g~q~~wHEiaRPQiHGyDl~c~~~vn~ 418 (764)
T KOG1063|consen 340 FHLWKTKDKTFWTQEPVISGHVDGVKDVDWDPSGEFLLSVSLDQTTRLFARW-GRQQEWHEIARPQIHGYDLTCLSFVNE 418 (764)
T ss_pred EEEEeccCccceeeccccccccccceeeeecCCCCEEEEeccccceeeeccc-ccccceeeecccccccccceeeehccC
Confidence 9999832211112223335899999999999999999999999777776432 0000 000 0000000
Q ss_pred cceecCCCCCc---------------------------------------------------------------------
Q 018806 190 LGALSRGPGTR--------------------------------------------------------------------- 200 (350)
Q Consensus 190 ~~~~~~~~~~~--------------------------------------------------------------------- 200 (350)
...|..+.+.+
T Consensus 419 ~~~FVSgAdEKVlRvF~aPk~fv~~l~~i~g~~~~~~~~~p~gA~VpaLGLSnKa~~~~e~~~G~~~~~~~et~~~~~p~ 498 (764)
T KOG1063|consen 419 DLQFVSGADEKVLRVFEAPKSFVKSLMAICGKCFKGSDELPDGANVPALGLSNKAFFPGETNTGGEAAVCAETPLAAAPC 498 (764)
T ss_pred CceeeecccceeeeeecCcHHHHHHHHHHhCccccCchhcccccccccccccCCCCcccccccccccceeeecccccCch
Confidence 00000000000
Q ss_pred ----------------eEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC----CeEEEEeCCCCCcee-eeecCCCeEE
Q 018806 201 ----------------WTLVDFLRSQNGEQITALSWGPDGRYLASASYES----SSFTIWDVAQGLGTP-IRRGFGGLSI 259 (350)
Q Consensus 201 ----------------~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~----g~i~iwd~~~~~~~~-~~~~~~~v~~ 259 (350)
|.-...+.||. ..|++++.+|+|+.+|+++... -.|++|+..+-.... +..|.-.|+.
T Consensus 499 ~L~ePP~EdqLq~~tLwPEv~KLYGHG-yEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L~~HsLTVT~ 577 (764)
T KOG1063|consen 499 ELTEPPTEDQLQQNTLWPEVHKLYGHG-YEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQELEGHSLTVTR 577 (764)
T ss_pred hccCCChHHHHHHhccchhhHHhccCc-eeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhheecccceEEEE
Confidence 01122456775 7999999999999999986542 279999998765544 7788899999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCce-----eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTS-----EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-----~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
++|||||++|++.+.|+++.+|....... .....|..-|+++.|+|++.++++++ |+...+|..
T Consensus 578 l~FSpdg~~LLsvsRDRt~sl~~~~~~~~~e~~fa~~k~HtRIIWdcsW~pde~~FaTaSRDK~VkVW~~ 647 (764)
T KOG1063|consen 578 LAFSPDGRYLLSVSRDRTVSLYEVQEDIKDEFRFACLKAHTRIIWDCSWSPDEKYFATASRDKKVKVWEE 647 (764)
T ss_pred EEECCCCcEEEEeecCceEEeeeeecccchhhhhccccccceEEEEcccCcccceeEEecCCceEEEEec
Confidence 99999999999999999999998855433 12557888899999999999999886 444444433
No 129
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.79 E-value=1.2e-17 Score=130.86 Aligned_cols=173 Identities=17% Similarity=0.269 Sum_probs=127.0
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceee-ccc-----------ccccceecCCCCCceEEeeecc
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVR-SGA-----------ASFLGALSRGPGTRWTLVDFLR 208 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~-~~~-----------~~~~~~~~~~~~~~~~~~~~~~ 208 (350)
.+|...|.+++|+-+|.++++++.|+++.+|+++......... .+. ..+..-++.+.+..+..|+.-.
T Consensus 17 ~~~~~~v~Sv~wn~~g~~lasgs~dktv~v~n~e~~r~~~~~~~~gh~~svdql~w~~~~~d~~atas~dk~ir~wd~r~ 96 (313)
T KOG1407|consen 17 QGHVQKVHSVAWNCDGTKLASGSFDKTVSVWNLERDRFRKELVYRGHTDSVDQLCWDPKHPDLFATASGDKTIRIWDIRS 96 (313)
T ss_pred hhhhhcceEEEEcccCceeeecccCCceEEEEecchhhhhhhcccCCCcchhhheeCCCCCcceEEecCCceEEEEEecc
Confidence 4688899999999999999999999999999998432221111 111 1122224445555666665433
Q ss_pred CC------CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-------------------------------------
Q 018806 209 SQ------NGEQITALSWGPDGRYLASASYESSSFTIWDVAQG------------------------------------- 245 (350)
Q Consensus 209 ~~------~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~------------------------------------- 245 (350)
+. ..+.-.-+.|+|+|.+++.++.|+ .|.+.|.++.
T Consensus 97 ~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD-~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILs 175 (313)
T KOG1407|consen 97 GKCTARIETKGENINITWSPDGEYIAVGNKDD-RITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILS 175 (313)
T ss_pred CcEEEEeeccCcceEEEEcCCCCEEEEecCcc-cEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEe
Confidence 32 112335689999999999999986 8888777643
Q ss_pred ----Cc-eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 246 ----LG-TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 246 ----~~-~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+. ..+..|.....|+.|+|+|+++|+|+.|..+.+||++..-+ +.+..+.-+|..++||.||++||+++
T Consensus 176 ypsLkpv~si~AH~snCicI~f~p~GryfA~GsADAlvSLWD~~ELiC~R~isRldwpVRTlSFS~dg~~lASaS 250 (313)
T KOG1407|consen 176 YPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADALVSLWDVDELICERCISRLDWPVRTLSFSHDGRMLASAS 250 (313)
T ss_pred ccccccccccccCCcceEEEEECCCCceEeeccccceeeccChhHhhhheeeccccCceEEEEeccCcceeeccC
Confidence 11 12334666778999999999999999999999999987766 44667889999999999999999986
No 130
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.78 E-value=1.6e-16 Score=136.64 Aligned_cols=197 Identities=15% Similarity=0.075 Sum_probs=136.3
Q ss_pred CeeEEEEecCCCEEEEE-ECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFI-SGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~-s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~ 178 (350)
.+..+.|+|+++.++++ +.++.+++||+.. ......+ .+...+.+++|+|+|..++++..+ ..+.+||......
T Consensus 74 ~~~~~~~~~~g~~l~~~~~~~~~l~~~d~~~--~~~~~~~--~~~~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~~~~ 149 (300)
T TIGR03866 74 DPELFALHPNGKILYIANEDDNLVTVIDIET--RKVLAEI--PVGVEPEGMAVSPDGKIVVNTSETTNMAHFIDTKTYEI 149 (300)
T ss_pred CccEEEECCCCCEEEEEcCCCCeEEEEECCC--CeEEeEe--eCCCCcceEEECCCCCEEEEEecCCCeEEEEeCCCCeE
Confidence 35678999999977665 4689999999953 3333333 233457889999998888777766 4567778763221
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe-CCCeEEEEeCCCCCceeeee-c---
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY-ESSSFTIWDVAQGLGTPIRR-G--- 253 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d~g~i~iwd~~~~~~~~~~~-~--- 253 (350)
. ..+.. ...+..++|+|+|++|++++. + |.|++||+++++...... +
T Consensus 150 ~-------------------------~~~~~--~~~~~~~~~s~dg~~l~~~~~~~-~~v~i~d~~~~~~~~~~~~~~~~ 201 (300)
T TIGR03866 150 V-------------------------DNVLV--DQRPRFAEFTADGKELWVSSEIG-GTVSVIDVATRKVIKKITFEIPG 201 (300)
T ss_pred E-------------------------EEEEc--CCCccEEEECCCCCEEEEEcCCC-CEEEEEEcCcceeeeeeeecccc
Confidence 1 11111 134577999999998876654 6 799999999886543221 1
Q ss_pred ----CCCeEEEEEcCCCCEEEEE-ecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 254 ----FGGLSILKWSPTGDYFFAA-KFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 254 ----~~~v~~~~~sp~g~~l~~~-~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
......++|+|+|++++++ +.++.+.+||+++++......+...+.+++|+|+|++|+++...+..+..|++...
T Consensus 202 ~~~~~~~~~~i~~s~dg~~~~~~~~~~~~i~v~d~~~~~~~~~~~~~~~~~~~~~~~~g~~l~~~~~~~~~i~v~d~~~~ 281 (300)
T TIGR03866 202 VHPEAVQPVGIKLTKDGKTAFVALGPANRVAVVDAKTYEVLDYLLVGQRVWQLAFTPDEKYLLTTNGVSNDVSVIDVAAL 281 (300)
T ss_pred cccccCCccceEECCCCCEEEEEcCCCCeEEEEECCCCcEEEEEEeCCCcceEEECCCCCEEEEEcCCCCeEEEEECCCC
Confidence 1123468899999986544 45678999999988876544455678999999999999887644445666666543
Q ss_pred C
Q 018806 329 P 329 (350)
Q Consensus 329 ~ 329 (350)
.
T Consensus 282 ~ 282 (300)
T TIGR03866 282 K 282 (300)
T ss_pred c
Confidence 3
No 131
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.78 E-value=1.7e-17 Score=137.05 Aligned_cols=207 Identities=17% Similarity=0.259 Sum_probs=150.4
Q ss_pred cCeeEEEEec-----CCCEEEEE---ECCCeEEEEEccCCCCCce--eEecCCCCCCeeEEEEeeCCCeEEEEec-CCcE
Q 018806 100 VDLQGVSWHQ-----HKHIVAFI---SGSTQVIVRDYEDSEGKDA--CILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGI 168 (350)
Q Consensus 100 ~~V~~v~~sp-----~g~~la~~---s~d~~i~iw~~~~~~~~~~--~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v 168 (350)
..|+.++|.. +.++||.. +..|...+.-+. +.|+.. .-+..+|.++|..++|+|-+...+++|+ |.+|
T Consensus 28 IrVs~~tWDS~fcavNPkfiAvi~easgGgaf~ViPl~-k~Gr~d~~~P~v~GHt~~vLDi~w~PfnD~vIASgSeD~~v 106 (472)
T KOG0303|consen 28 IRVSRVTWDSSFCAVNPKFVAVIIEASGGGAFLVIPLV-KTGRMDASYPLVCGHTAPVLDIDWCPFNDCVIASGSEDTKV 106 (472)
T ss_pred eeeeeeeccccccccCCceEEEEEecCCCcceeecccc-cccccCCCCCCccCccccccccccCccCCceeecCCCCceE
Confidence 3566777653 45677763 334455454443 223221 1223489999999999997666666655 7999
Q ss_pred EEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc
Q 018806 169 CIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLG 247 (350)
Q Consensus 169 ~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~ 247 (350)
.||.+...+....+.. ....+.+|. ..|--++|+|- .+.|++++.|+ +|.+||+.+++.
T Consensus 107 ~vW~IPe~~l~~~lte------------------pvv~L~gH~-rrVg~V~wHPtA~NVLlsag~Dn-~v~iWnv~tgea 166 (472)
T KOG0303|consen 107 MVWQIPENGLTRDLTE------------------PVVELYGHQ-RRVGLVQWHPTAPNVLLSAGSDN-TVSIWNVGTGEA 166 (472)
T ss_pred EEEECCCcccccCccc------------------ceEEEeecc-eeEEEEeecccchhhHhhccCCc-eEEEEeccCCce
Confidence 9999986655443322 255688887 79999999996 45678888896 999999999987
Q ss_pred eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecc-ccCCC-CeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 248 TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPW-SSTSG-FVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 248 ~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~-~~~~~-~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.....|..-|++++|+.||.+|++.+.|+.|+|||.++++.... ..|.+ ....+.|-.+|. +++++-.......+-+
T Consensus 167 li~l~hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~~v~e~~~heG~k~~Raifl~~g~-i~tTGfsr~seRq~aL 245 (472)
T KOG0303|consen 167 LITLDHPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGTVVSEGVAHEGAKPARAIFLASGK-IFTTGFSRMSERQIAL 245 (472)
T ss_pred eeecCCCCeEEEEEeccCCceeeeecccceeEEEcCCCCcEeeecccccCCCcceeEEeccCc-eeeeccccccccceec
Confidence 76666999999999999999999999999999999999998433 35543 456788999999 5555433445566666
Q ss_pred CCC
Q 018806 326 ASK 328 (350)
Q Consensus 326 ~~~ 328 (350)
|+.
T Consensus 246 wdp 248 (472)
T KOG0303|consen 246 WDP 248 (472)
T ss_pred cCc
Confidence 653
No 132
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.78 E-value=2e-17 Score=139.30 Aligned_cols=198 Identities=16% Similarity=0.131 Sum_probs=148.9
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccC-------CCCCceeEecCCCCCCeeEEEEeeC--CCeEEEEecCCcEEEE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYED-------SEGKDACILTSDSQRDVKVLEWRPN--GGRSLSVGCKGGICIW 171 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~-------~~~~~~~~~~~~~~~~v~~~~~sp~--~~~l~~~~~d~~v~iw 171 (350)
+|+|+.|+-||.+|++|+.||.|.+|.+.. .+.+..+ .+.+|.-+|+++...+- ..++++++.|.++++|
T Consensus 125 ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~a~~~~~~~p~~-~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~w 203 (476)
T KOG0646|consen 125 SITCLKFSDDGSHIITGSKDGAVLVWLLTDLVSADNDHSVKPLH-IFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLW 203 (476)
T ss_pred ceeEEEEeCCCcEEEecCCCccEEEEEEEeecccccCCCcccee-eeccCcceeEEEEecCCCccceEEEecCCceEEEE
Confidence 599999999999999999999999998632 1222333 33589999999988654 3688999999999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-----
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL----- 246 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~----- 246 (350)
|+..+.....+. .+..+.+++.+|-++.+++|+.+ |.|.+.++..-.
T Consensus 204 dlS~g~LLlti~---------------------------fp~si~av~lDpae~~~yiGt~~-G~I~~~~~~~~~~~~~~ 255 (476)
T KOG0646|consen 204 DLSLGVLLLTIT---------------------------FPSSIKAVALDPAERVVYIGTEE-GKIFQNLLFKLSGQSAG 255 (476)
T ss_pred EeccceeeEEEe---------------------------cCCcceeEEEcccccEEEecCCc-ceEEeeehhcCCccccc
Confidence 998543322221 13689999999999999999999 799988775432
Q ss_pred ------------ceeeeecCC--CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-cCCCCeEEEEEcCCCCEEE
Q 018806 247 ------------GTPIRRGFG--GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-STSGFVTGATWDPEGRMIL 311 (350)
Q Consensus 247 ------------~~~~~~~~~--~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-~~~~~v~~~~~s~~g~~l~ 311 (350)
...+.+|.+ .|+|++.+-||..|++|+.||.|+|||+.+.++.+.. ...++|+.+.+.|=-+-.+
T Consensus 256 v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSGd~dg~VcvWdi~S~Q~iRtl~~~kgpVtnL~i~~~~~~~~ 335 (476)
T KOG0646|consen 256 VNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSGDEDGKVCVWDIYSKQCIRTLQTSKGPVTNLQINPLERGII 335 (476)
T ss_pred ccccccccccceeeeeccccCCcceeEEEEecCccEEEeeCCCCCEEEEecchHHHHHHHhhhccccceeEeecccccee
Confidence 112345655 8999999999999999999999999999998885444 3778999999976544444
Q ss_pred EEECCCeEEEEEEeCC
Q 018806 312 LAFAGSLTLGSIHFAS 327 (350)
Q Consensus 312 ~~~~~~~~~~~~~~~~ 327 (350)
.+....-.+..+++..
T Consensus 336 l~~~~~ps~~~~~lkr 351 (476)
T KOG0646|consen 336 LFEHKQPSLPNPHLKR 351 (476)
T ss_pred cccccCccCCchHhhc
Confidence 4433333344444433
No 133
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.77 E-value=3.6e-17 Score=130.65 Aligned_cols=160 Identities=16% Similarity=0.308 Sum_probs=121.2
Q ss_pred eEecCCCCCCeeEEEEeeCCCeEE-EEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCce
Q 018806 137 CILTSDSQRDVKVLEWRPNGGRSL-SVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQI 215 (350)
Q Consensus 137 ~~~~~~~~~~v~~~~~sp~~~~l~-~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v 215 (350)
..+.......|.+++|||....++ +++.|++||+|++...+.... +....| +++|
T Consensus 20 ~ev~~pP~DsIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~-----------------------ka~~~~-~~Pv 75 (347)
T KOG0647|consen 20 YEVPNPPEDSISALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVP-----------------------KAQQSH-DGPV 75 (347)
T ss_pred eecCCCcccchheeEeccccCceEEecccCCceEEEEEecCCcccc-----------------------hhhhcc-CCCe
Confidence 334445678899999999655566 555599999999985322211 112334 4799
Q ss_pred eeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCC--EEEEEecCCeEEEEeCCCCceecccc
Q 018806 216 TALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGD--YFFAAKFDGTFYLWETNTWTSEPWSS 293 (350)
Q Consensus 216 ~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~--~l~~~~~d~~v~iwd~~~~~~~~~~~ 293 (350)
.+++|+.||..+++++.| +.+++||+.+++...+..|.++|..+.|-+... .|++|+.|++|+.||++.........
T Consensus 76 L~v~WsddgskVf~g~~D-k~~k~wDL~S~Q~~~v~~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~ 154 (347)
T KOG0647|consen 76 LDVCWSDDGSKVFSGGCD-KQAKLWDLASGQVSQVAAHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQ 154 (347)
T ss_pred EEEEEccCCceEEeeccC-CceEEEEccCCCeeeeeecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeee
Confidence 999999999999999999 699999999999888999999999999987655 78999999999999999887755555
Q ss_pred CCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 294 TSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 294 ~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
..+.++++..- ..++++++ +..+.++.+
T Consensus 155 LPeRvYa~Dv~--~pm~vVata~r~i~vynL 183 (347)
T KOG0647|consen 155 LPERVYAADVL--YPMAVVATAERHIAVYNL 183 (347)
T ss_pred ccceeeehhcc--CceeEEEecCCcEEEEEc
Confidence 55667666533 34566665 444444444
No 134
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.77 E-value=3.1e-16 Score=140.86 Aligned_cols=215 Identities=14% Similarity=0.166 Sum_probs=147.5
Q ss_pred CeeEEEEecCCCEEEEEEC---CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CC--cEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISG---STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KG--GICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~---d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~--~v~iwd~~ 174 (350)
.+.+.+|||||+.||+.+. +..+.+|++.. ++. ..+. ...+.+..++|+|||+++++... ++ .|++||+.
T Consensus 200 ~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~--G~~-~~l~-~~~~~~~~~~~SPDG~~La~~~~~~g~~~I~~~d~~ 275 (429)
T PRK03629 200 PLMSPAWSPDGSKLAYVTFESGRSALVIQTLAN--GAV-RQVA-SFPRHNGAPAFSPDGSKLAFALSKTGSLNLYVMDLA 275 (429)
T ss_pred ceeeeEEcCCCCEEEEEEecCCCcEEEEEECCC--CCe-EEcc-CCCCCcCCeEECCCCCEEEEEEcCCCCcEEEEEECC
Confidence 6889999999999998653 45688888854 432 2221 23344567899999998887654 44 58888886
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~ 252 (350)
.+. ... +..+. ..+....|+|||+.|++.+.+.| .|+++|+.++....+..
T Consensus 276 tg~-~~~-------------------------lt~~~-~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~~g~~~~lt~ 328 (429)
T PRK03629 276 SGQ-IRQ-------------------------VTDGR-SNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNINGGAPQRITW 328 (429)
T ss_pred CCC-EEE-------------------------ccCCC-CCcCceEECCCCCEEEEEeCCCCCceEEEEECCCCCeEEeec
Confidence 322 111 12222 45678999999999988876534 45555777776655544
Q ss_pred cCCCeEEEEEcCCCCEEEEEecC---CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC-CC-eEEEEEEeCC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFD---GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA-GS-LTLGSIHFAS 327 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~-~~-~~~~~~~~~~ 327 (350)
........+|+|||++|+..+.+ ..|++||+.+++...+... ....+..|+|||++|++++. +. ..++.+.+..
T Consensus 329 ~~~~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~~g~~~~Lt~~-~~~~~p~~SpDG~~i~~~s~~~~~~~l~~~~~~G 407 (429)
T PRK03629 329 EGSQNQDADVSSDGKFMVMVSSNGGQQHIAKQDLATGGVQVLTDT-FLDETPSIAPNGTMVIYSSSQGMGSVLNLVSTDG 407 (429)
T ss_pred CCCCccCEEECCCCCEEEEEEccCCCceEEEEECCCCCeEEeCCC-CCCCCceECCCCCEEEEEEcCCCceEEEEEECCC
Confidence 44556678999999999876543 3688999998887655532 23457889999999999873 32 3466777765
Q ss_pred CC-CCCceeecccccceeecc
Q 018806 328 KP-PSLDAHLLPVDLPDIVSL 347 (350)
Q Consensus 328 ~~-~~~~~~~~~v~~~~~~~~ 347 (350)
.. ..+.+|...+..|.+.+.
T Consensus 408 ~~~~~l~~~~~~~~~p~Wsp~ 428 (429)
T PRK03629 408 RFKARLPATDGQVKFPAWSPY 428 (429)
T ss_pred CCeEECccCCCCcCCcccCCC
Confidence 43 356677777777777653
No 135
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.77 E-value=1.1e-16 Score=143.97 Aligned_cols=216 Identities=20% Similarity=0.251 Sum_probs=141.3
Q ss_pred cCeeEEEEecCCCEEEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSY 175 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~ 175 (350)
..+.+++|||||++|++++.+ ..|++||+.. +...... ...+....++|+|||+.++++.. ++.+.||.++.
T Consensus 204 ~~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~t--g~~~~l~--~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~d~ 279 (429)
T PRK01742 204 QPLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRS--GARKVVA--SFRGHNGAPAFSPDGSRLAFASSKDGVLNIYVMGA 279 (429)
T ss_pred CccccceEcCCCCEEEEEEecCCCcEEEEEeCCC--CceEEEe--cCCCccCceeECCCCCEEEEEEecCCcEEEEEEEC
Confidence 368999999999999998754 3699999854 3322221 12233457899999988888764 67776665542
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-ceeeeecC
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL-GTPIRRGF 254 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~-~~~~~~~~ 254 (350)
.... ...+..+. ..+..+.|+|||+.|++++..+|...+|+++... ......+.
T Consensus 280 ~~~~------------------------~~~lt~~~-~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~~~~l~~~ 334 (429)
T PRK01742 280 NGGT------------------------PSQLTSGA-GNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGGASLVGGR 334 (429)
T ss_pred CCCC------------------------eEeeccCC-CCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCCeEEecCC
Confidence 2111 11123332 4678899999999988777544677888765322 22223333
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEE-EEeCCC-CCC
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGS-IHFASK-PPS 331 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~-~~~~~~-~~~ 331 (350)
. ..+.|+|||++|++.+.++ +.+||+.+++...+... ....+++|+|||++|++++ ++...++. +..... ...
T Consensus 335 ~--~~~~~SpDG~~ia~~~~~~-i~~~Dl~~g~~~~lt~~-~~~~~~~~sPdG~~i~~~s~~g~~~~l~~~~~~G~~~~~ 410 (429)
T PRK01742 335 G--YSAQISADGKTLVMINGDN-VVKQDLTSGSTEVLSST-FLDESPSISPNGIMIIYSSTQGLGKVLQLVSADGRFKAR 410 (429)
T ss_pred C--CCccCCCCCCEEEEEcCCC-EEEEECCCCCeEEecCC-CCCCCceECCCCCEEEEEEcCCCceEEEEEECCCCceEE
Confidence 3 4678999999998887765 56699999876544322 2345788999999999987 44444333 333333 235
Q ss_pred Cceeecccccceeeccc
Q 018806 332 LDAHLLPVDLPDIVSLT 348 (350)
Q Consensus 332 ~~~~~~~v~~~~~~~~~ 348 (350)
+..|...+..|.+++.-
T Consensus 411 l~~~~g~~~~p~wsp~~ 427 (429)
T PRK01742 411 LPGSDGQVKFPAWSPYL 427 (429)
T ss_pred ccCCCCCCCCcccCCCC
Confidence 66777777778877654
No 136
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.77 E-value=1.6e-17 Score=138.36 Aligned_cols=196 Identities=17% Similarity=0.284 Sum_probs=143.2
Q ss_pred eEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCcee
Q 018806 103 QGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASV 182 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~ 182 (350)
.+++|+.+|..|++++.||++|||++.. ..... ....|.+.|.++.|+|||+.+++.+.| ..+||+...+......
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps--~~t~l-~e~~~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~g~~~a~~ 223 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPS--MLTIL-EEIAHHAEVKDLDFSPDGKFLASIGAD-SARVWSVNTGAALARK 223 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCc--chhhh-hhHhhcCccccceeCCCCcEEEEecCC-ceEEEEeccCchhhhc
Confidence 7899999999999999999999999742 22222 223688999999999999999999999 8999999965333222
Q ss_pred ecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC---Ce-EEEEEeCCCeEEEEeCCCCCc------eeeee
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG---RY-LASASYESSSFTIWDVAQGLG------TPIRR 252 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g---~~-l~~~~~d~g~i~iwd~~~~~~------~~~~~ 252 (350)
... . .+.....+.|+.|+ .+ +++.....+.|+.||+..... .....
T Consensus 224 t~~-----------------------~-k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~ 279 (398)
T KOG0771|consen 224 TPF-----------------------S-KDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIK 279 (398)
T ss_pred CCc-----------------------c-cchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhh
Confidence 111 1 12455677777765 22 333333335666666543322 12223
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc--cCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS--STSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFA 326 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~--~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~ 326 (350)
....+++++.+++|++++.|+.||.|-|++..+.+...+. .|...|+.+.|+||.++++..+ +....+..+...
T Consensus 280 ~~~siSsl~VS~dGkf~AlGT~dGsVai~~~~~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~svSs~~~~~v~~l~vd 356 (398)
T KOG0771|consen 280 RFKSISSLAVSDDGKFLALGTMDGSVAIYDAKSLQRLQYVKEAHLGFVTGLTFSPDSRYLASVSSDNEAAVTKLAVD 356 (398)
T ss_pred ccCcceeEEEcCCCcEEEEeccCCcEEEEEeceeeeeEeehhhheeeeeeEEEcCCcCcccccccCCceeEEEEeec
Confidence 3568999999999999999999999999999988875543 6888999999999999998855 555666666653
No 137
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.76 E-value=3.2e-16 Score=140.85 Aligned_cols=218 Identities=18% Similarity=0.227 Sum_probs=143.3
Q ss_pred ccCeeEEEEecCCCEEEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPS 174 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~ 174 (350)
...+.+.+|||||+.|++.+.+ ..|.+||+.. +.... +. ...+.+...+|+|||+.++.... ++...||.++
T Consensus 195 ~~~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~--g~~~~-l~-~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d 270 (427)
T PRK02889 195 PEPIISPAWSPDGTKLAYVSFESKKPVVYVHDLAT--GRRRV-VA-NFKGSNSAPAWSPDGRTLAVALSRDGNSQIYTVN 270 (427)
T ss_pred CCCcccceEcCCCCEEEEEEccCCCcEEEEEECCC--CCEEE-ee-cCCCCccceEECCCCCEEEEEEccCCCceEEEEE
Confidence 3468899999999999987753 4588889854 43322 22 23456678999999988876544 6777777665
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEE--eCCCCCceeeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIW--DVAQGLGTPIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iw--d~~~~~~~~~~~ 252 (350)
..... ...+..+. .......|+|||++|++.+...|...+| ++.++....+..
T Consensus 271 ~~~~~------------------------~~~lt~~~-~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~~g~~~~lt~ 325 (427)
T PRK02889 271 ADGSG------------------------LRRLTQSS-GIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPASGGAAQRVTF 325 (427)
T ss_pred CCCCC------------------------cEECCCCC-CCCcCeEEcCCCCEEEEEecCCCCcEEEEEECCCCceEEEec
Confidence 32211 11122222 3456789999999998877643555555 555555444433
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCC---eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDG---TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHFAS 327 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~---~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~ 327 (350)
........+|+|||++|+..+.++ .|++||+.+++...+... .....+.|+|||++|+++. .+...++.++...
T Consensus 326 ~g~~~~~~~~SpDG~~Ia~~s~~~g~~~I~v~d~~~g~~~~lt~~-~~~~~p~~spdg~~l~~~~~~~g~~~l~~~~~~g 404 (427)
T PRK02889 326 TGSYNTSPRISPDGKLLAYISRVGGAFKLYVQDLATGQVTALTDT-TRDESPSFAPNGRYILYATQQGGRSVLAAVSSDG 404 (427)
T ss_pred CCCCcCceEECCCCCEEEEEEccCCcEEEEEEECCCCCeEEccCC-CCccCceECCCCCEEEEEEecCCCEEEEEEECCC
Confidence 333445689999999998776544 699999999887655433 3456789999999999987 3334577777655
Q ss_pred CCC-CCceeecccccceeec
Q 018806 328 KPP-SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 328 ~~~-~~~~~~~~v~~~~~~~ 346 (350)
... .+..+...+..|.+.+
T Consensus 405 ~~~~~l~~~~g~~~~p~wsp 424 (427)
T PRK02889 405 RIKQRLSVQGGDVREPSWGP 424 (427)
T ss_pred CceEEeecCCCCCCCCccCC
Confidence 433 3333444555666554
No 138
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.76 E-value=1e-16 Score=132.46 Aligned_cols=204 Identities=19% Similarity=0.309 Sum_probs=153.8
Q ss_pred ccCeeEEEEec-CCCEEEEEECCCeEEEEEccCCC----CCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEe
Q 018806 99 EVDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSE----GKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWA 172 (350)
Q Consensus 99 ~~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~----~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd 172 (350)
..+|..++|+| +.+.||+||.|.+|.||.+..+. -........+|...|.-++|+|... .|+++|.|++|.+||
T Consensus 81 t~~vLDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iWn 160 (472)
T KOG0303|consen 81 TAPVLDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIWN 160 (472)
T ss_pred cccccccccCccCCceeecCCCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCceEEEEe
Confidence 45799999999 45789999999999999985321 1122333458999999999999754 466777899999999
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR- 251 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~- 251 (350)
+.++.... ++. | +..|.++.|+.||.+|++++.|+ .|+|||.++++.....
T Consensus 161 v~tgeali-------------------------~l~-h-pd~i~S~sfn~dGs~l~TtckDK-kvRv~dpr~~~~v~e~~ 212 (472)
T KOG0303|consen 161 VGTGEALI-------------------------TLD-H-PDMVYSMSFNRDGSLLCTTCKDK-KVRVIDPRRGTVVSEGV 212 (472)
T ss_pred ccCCceee-------------------------ecC-C-CCeEEEEEeccCCceeeeecccc-eeEEEcCCCCcEeeecc
Confidence 99654321 133 4 47999999999999999999996 9999999999876533
Q ss_pred ecCC-CeEEEEEcCCCCEEEEE---ecCCeEEEEeCCCCce---eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEE
Q 018806 252 RGFG-GLSILKWSPTGDYFFAA---KFDGTFYLWETNTWTS---EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIH 324 (350)
Q Consensus 252 ~~~~-~v~~~~~sp~g~~l~~~---~~d~~v~iwd~~~~~~---~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~ 324 (350)
.|.+ ....+.|-.+|.++.+| ..++.+.+||..+-+. .+.....+.|.-.-|.+|...|+.++.++..|.-..
T Consensus 213 ~heG~k~~Raifl~~g~i~tTGfsr~seRq~aLwdp~nl~eP~~~~elDtSnGvl~PFyD~dt~ivYl~GKGD~~IRYyE 292 (472)
T KOG0303|consen 213 AHEGAKPARAIFLASGKIFTTGFSRMSERQIALWDPNNLEEPIALQELDTSNGVLLPFYDPDTSIVYLCGKGDSSIRYFE 292 (472)
T ss_pred cccCCCcceeEEeccCceeeeccccccccceeccCcccccCcceeEEeccCCceEEeeecCCCCEEEEEecCCcceEEEE
Confidence 4543 35567788899855555 2477999999877554 233345667777789999999999987777777777
Q ss_pred eCCCCC
Q 018806 325 FASKPP 330 (350)
Q Consensus 325 ~~~~~~ 330 (350)
+...++
T Consensus 293 it~d~P 298 (472)
T KOG0303|consen 293 ITNEPP 298 (472)
T ss_pred ecCCCc
Confidence 666554
No 139
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.76 E-value=3.8e-17 Score=137.30 Aligned_cols=201 Identities=16% Similarity=0.223 Sum_probs=151.4
Q ss_pred ccCeeEEEEecCC--CEEEEEECCCeEEEEEccCCCC-CceeEecCCCCCCeeEEEEeeCC-CeEEEEecCCcEEEEecC
Q 018806 99 EVDLQGVSWHQHK--HIVAFISGSTQVIVRDYEDSEG-KDACILTSDSQRDVKVLEWRPNG-GRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 99 ~~~V~~v~~sp~g--~~la~~s~d~~i~iw~~~~~~~-~~~~~~~~~~~~~v~~~~~sp~~-~~l~~~~~d~~v~iwd~~ 174 (350)
...|++++|+|.. +++|+|...|.|-+||+..... .....+...|..+|.++.|+|.+ .++++++.||+|++-|++
T Consensus 186 ~~Rit~l~fHPt~~~~lva~GdK~G~VG~Wn~~~~~~d~d~v~~f~~hs~~Vs~l~F~P~n~s~i~ssSyDGtiR~~D~~ 265 (498)
T KOG4328|consen 186 DRRITSLAFHPTENRKLVAVGDKGGQVGLWNFGTQEKDKDGVYLFTPHSGPVSGLKFSPANTSQIYSSSYDGTIRLQDFE 265 (498)
T ss_pred ccceEEEEecccCcceEEEEccCCCcEEEEecCCCCCccCceEEeccCCccccceEecCCChhheeeeccCceeeeeeec
Confidence 3479999999976 5888899999999999952111 12233445799999999999964 467888889999999998
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--eeeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG--TPIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~ 252 (350)
.... ..+.. +... .....++.|+.+.+.++++..- |...+||.+++.. ..+.-
T Consensus 266 ~~i~-e~v~s----------------------~~~d-~~~fs~~d~~~e~~~vl~~~~~-G~f~~iD~R~~~s~~~~~~l 320 (498)
T KOG4328|consen 266 GNIS-EEVLS----------------------LDTD-NIWFSSLDFSAESRSVLFGDNV-GNFNVIDLRTDGSEYENLRL 320 (498)
T ss_pred chhh-HHHhh----------------------cCcc-ceeeeeccccCCCccEEEeecc-cceEEEEeecCCccchhhhh
Confidence 3221 11111 1111 2466788898888888888887 6999999998754 34556
Q ss_pred cCCCeEEEEEcCCCC-EEEEEecCCeEEEEeCCCCce-----eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 253 GFGGLSILKWSPTGD-YFFAAKFDGTFYLWETNTWTS-----EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~-~l~~~~~d~~v~iwd~~~~~~-----~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
|...|.+++++|... +||+++.|++.+|||++.-.. .....|...|.++.|||.|-.|++.+ +..+.+++..
T Consensus 321 h~kKI~sv~~NP~~p~~laT~s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~TT~~D~~IRv~dss 399 (498)
T KOG4328|consen 321 HKKKITSVALNPVCPWFLATASLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLLTTCQDNEIRVFDSS 399 (498)
T ss_pred hhcccceeecCCCCchheeecccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceEeeccCCceEEeecc
Confidence 778999999999755 579999999999999986443 23457889999999999988888777 6666666663
No 140
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.76 E-value=1.3e-16 Score=126.85 Aligned_cols=190 Identities=12% Similarity=0.280 Sum_probs=138.8
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEec----CCCCCCeeEEEEee-CCCeEEEEecCCcEEEEecCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILT----SDSQRDVKVLEWRP-NGGRSLSVGCKGGICIWAPSY 175 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~----~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iwd~~~ 175 (350)
.|.|+.|.|++..||+-. |..|.+|+++..... ...+. .++....++-+|+| .....+++..|+++..||+++
T Consensus 125 ~i~cvew~Pns~klasm~-dn~i~l~~l~ess~~-vaev~ss~s~e~~~~ftsg~WspHHdgnqv~tt~d~tl~~~D~RT 202 (370)
T KOG1007|consen 125 KINCVEWEPNSDKLASMD-DNNIVLWSLDESSKI-VAEVLSSESAEMRHSFTSGAWSPHHDGNQVATTSDSTLQFWDLRT 202 (370)
T ss_pred ceeeEEEcCCCCeeEEec-cCceEEEEcccCcch-heeecccccccccceecccccCCCCccceEEEeCCCcEEEEEccc
Confidence 589999999999998754 888999999743221 22221 13556788999999 345667778899999999995
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--eeeeec
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG--TPIRRG 253 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~ 253 (350)
..+...+. ..| ...|.++.|+|+-++++..+.|+|.|++||.+..+. ..+..|
T Consensus 203 ~~~~~sI~------------------------dAH-gq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~H 257 (370)
T KOG1007|consen 203 MKKNNSIE------------------------DAH-GQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGH 257 (370)
T ss_pred hhhhcchh------------------------hhh-cceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCC
Confidence 54433322 223 468999999999877554444448999999997653 345578
Q ss_pred CCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCC------------------------------ceeccccCCCCeEEEE
Q 018806 254 FGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTW------------------------------TSEPWSSTSGFVTGAT 302 (350)
Q Consensus 254 ~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~------------------------------~~~~~~~~~~~v~~~~ 302 (350)
...|.++.|+|. .++|++++.|..|.+|...+- ...++..|+..|++++
T Consensus 258 sHWvW~VRfn~~hdqLiLs~~SDs~V~Lsca~svSSE~qi~~~~dese~e~~dseer~kpL~dg~l~tydehEDSVY~~a 337 (370)
T KOG1007|consen 258 SHWVWAVRFNPEHDQLILSGGSDSAVNLSCASSVSSEQQIEFEDDESESEDEDSEERVKPLQDGQLETYDEHEDSVYALA 337 (370)
T ss_pred ceEEEEEEecCccceEEEecCCCceeEEEeccccccccccccccccccCcchhhHHhcccccccccccccccccceEEEe
Confidence 899999999996 556789999999999965321 1123346889999999
Q ss_pred EcCCCCEEEEEECCC
Q 018806 303 WDPEGRMILLAFAGS 317 (350)
Q Consensus 303 ~s~~g~~l~~~~~~~ 317 (350)
||.-..+++++-+-+
T Consensus 338 WSsadPWiFASLSYD 352 (370)
T KOG1007|consen 338 WSSADPWIFASLSYD 352 (370)
T ss_pred eccCCCeeEEEeccC
Confidence 999999998775333
No 141
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.76 E-value=1.2e-17 Score=138.30 Aligned_cols=204 Identities=19% Similarity=0.311 Sum_probs=152.9
Q ss_pred ccCeeEEEEecCCC-EEEEEECCCeEEEEEccCCCCCc---ee---EecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEE
Q 018806 99 EVDLQGVSWHQHKH-IVAFISGSTQVIVRDYEDSEGKD---AC---ILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIW 171 (350)
Q Consensus 99 ~~~V~~v~~sp~g~-~la~~s~d~~i~iw~~~~~~~~~---~~---~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iw 171 (350)
..+|.++.|.++.. .||+|+.|..|+||.++...... .. .....|...|+.+.|+|+|..+++++.+|.+.+|
T Consensus 13 ~~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~v~lW 92 (434)
T KOG1009|consen 13 HEPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGEVFLW 92 (434)
T ss_pred CCceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCceEEEE
Confidence 44699999999876 99999999999999986432211 11 2223699999999999998888888888999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR 251 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~ 251 (350)
.... ..+. .. .. -+.-....|..+..+.+|. ..|..++|+|++.++++++.|+ .+++||+..|+.....
T Consensus 93 k~~~-~~~~--~~-----d~-e~~~~ke~w~v~k~lr~h~-~diydL~Ws~d~~~l~s~s~dn-s~~l~Dv~~G~l~~~~ 161 (434)
T KOG1009|consen 93 KQGD-VRIF--DA-----DT-EADLNKEKWVVKKVLRGHR-DDIYDLAWSPDSNFLVSGSVDN-SVRLWDVHAGQLLAIL 161 (434)
T ss_pred EecC-cCCc--cc-----cc-hhhhCccceEEEEEecccc-cchhhhhccCCCceeeeeeccc-eEEEEEeccceeEeec
Confidence 8762 1110 00 00 0111123588899999986 7999999999999999999996 9999999999887655
Q ss_pred -ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec------c--------------ccC----CCCeEEEEEcCC
Q 018806 252 -RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP------W--------------SST----SGFVTGATWDPE 306 (350)
Q Consensus 252 -~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~------~--------------~~~----~~~v~~~~~s~~ 306 (350)
.|...+..++|.|-++++++-+.|+..+++.+...+... + ..| ..-...++|+||
T Consensus 162 ~dh~~yvqgvawDpl~qyv~s~s~dr~~~~~~~~~~~~~~~~~~~~m~~~~~~~~e~~s~rLfhDeTlksFFrRlsfTPd 241 (434)
T KOG1009|consen 162 DDHEHYVQGVAWDPLNQYVASKSSDRHPEGFSAKLKQVIKRHGLDIMPAKAFNEREGKSTRLFHDETLKSFFRRLSFTPD 241 (434)
T ss_pred cccccccceeecchhhhhhhhhccCcccceeeeeeeeeeeeeeeeEeeecccCCCCcceeeeeecCchhhhhhhcccCCC
Confidence 577889999999999999999988877777665433210 0 011 123467899999
Q ss_pred CCEEEEE
Q 018806 307 GRMILLA 313 (350)
Q Consensus 307 g~~l~~~ 313 (350)
|.+|++.
T Consensus 242 G~llvtP 248 (434)
T KOG1009|consen 242 GSLLVTP 248 (434)
T ss_pred CcEEEcc
Confidence 9999875
No 142
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.76 E-value=4.5e-16 Score=133.94 Aligned_cols=185 Identities=12% Similarity=0.005 Sum_probs=131.1
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEe-cCCcEEEEecCCCCCCceeeccccccc
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVG-CKGGICIWAPSYPGNAASVRSGAASFL 190 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~-~d~~v~iwd~~~~~~~~~~~~~~~~~~ 190 (350)
..+++++.|+.+++||+.+ ++....+. .+ ..+..++|+|+++.+++++ .++.+++||.......
T Consensus 2 ~~~~s~~~d~~v~~~d~~t--~~~~~~~~-~~-~~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~~~----------- 66 (300)
T TIGR03866 2 KAYVSNEKDNTISVIDTAT--LEVTRTFP-VG-QRPRGITLSKDGKLLYVCASDSDTIQVIDLATGEVI----------- 66 (300)
T ss_pred cEEEEecCCCEEEEEECCC--CceEEEEE-CC-CCCCceEECCCCCEEEEEECCCCeEEEEECCCCcEE-----------
Confidence 5678889999999999854 55444443 33 3477899999988775554 4699999998743221
Q ss_pred ceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEE
Q 018806 191 GALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFF 270 (350)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~ 270 (350)
..+..+ ..+..++|+|+++.+++++.+++.+++||+.+.+..........+.+++|+|+|++++
T Consensus 67 --------------~~~~~~--~~~~~~~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~~~~~~~~~~~~dg~~l~ 130 (300)
T TIGR03866 67 --------------GTLPSG--PDPELFALHPNGKILYIANEDDNLVTVIDIETRKVLAEIPVGVEPEGMAVSPDGKIVV 130 (300)
T ss_pred --------------EeccCC--CCccEEEECCCCCEEEEEcCCCCeEEEEECCCCeEEeEeeCCCCcceEEECCCCCEEE
Confidence 112222 2456789999999887665433699999999876555444445578899999999999
Q ss_pred EEecCC-eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 271 AAKFDG-TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 271 ~~~~d~-~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
+++.++ .+.+||.++++..........+..++|+|+|++|++++..+..+..|++..
T Consensus 131 ~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~ 188 (300)
T TIGR03866 131 NTSETTNMAHFIDTKTYEIVDNVLVDQRPRFAEFTADGKELWVSSEIGGTVSVIDVAT 188 (300)
T ss_pred EEecCCCeEEEEeCCCCeEEEEEEcCCCccEEEECCCCCEEEEEcCCCCEEEEEEcCc
Confidence 887765 577889988776433333345678999999999977764444566665543
No 143
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.76 E-value=9e-17 Score=134.58 Aligned_cols=192 Identities=17% Similarity=0.287 Sum_probs=144.4
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCceeEec------------------CCCCCCeeEEEEeeCCCeEEEEec-CCcEEEE
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKDACILT------------------SDSQRDVKVLEWRPNGGRSLSVGC-KGGICIW 171 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~~~~~~------------------~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iw 171 (350)
|+++|.|+.|..|.|||++..+...++... .+|...|.+++|+-.-+.++++|+ |.+|++|
T Consensus 192 gNyvAiGtmdp~IeIWDLDI~d~v~P~~~LGs~~sk~~~k~~k~~~~~~gHTdavl~Ls~n~~~~nVLaSgsaD~TV~lW 271 (463)
T KOG0270|consen 192 GNYVAIGTMDPEIEIWDLDIVDAVLPCVTLGSKASKKKKKKGKRSNSASGHTDAVLALSWNRNFRNVLASGSADKTVKLW 271 (463)
T ss_pred cceEEEeccCceeEEeccccccccccceeechhhhhhhhhhcccccccccchHHHHHHHhccccceeEEecCCCceEEEE
Confidence 589999999999999999753332222221 258888999999987677666655 8999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCce-e
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLGT-P 249 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~~-~ 249 (350)
|+..++.. .++..| .+.|.++.|+|. ...|++|+.| |+|.+.|.+..... .
T Consensus 272 D~~~g~p~-------------------------~s~~~~-~k~Vq~l~wh~~~p~~LLsGs~D-~~V~l~D~R~~~~s~~ 324 (463)
T KOG0270|consen 272 DVDTGKPK-------------------------SSITHH-GKKVQTLEWHPYEPSVLLSGSYD-GTVALKDCRDPSNSGK 324 (463)
T ss_pred EcCCCCcc-------------------------eehhhc-CCceeEEEecCCCceEEEecccc-ceEEeeeccCccccCc
Confidence 99955442 234434 479999999995 6788999999 69999999953322 2
Q ss_pred eeecCCCeEEEEEcCCCCE-EEEEecCCeEEEEeCCCCc-e-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 250 IRRGFGGLSILKWSPTGDY-FFAAKFDGTFYLWETNTWT-S-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 250 ~~~~~~~v~~~~~sp~g~~-l~~~~~d~~v~iwd~~~~~-~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
.....+.|-.++|.|.... ++++..||+|+-+|++... . -++..|.++|.++++++.-..+++..+.+..+..|++.
T Consensus 325 ~wk~~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AHd~~ISgl~~n~~~p~~l~t~s~d~~Vklw~~~ 404 (463)
T KOG0270|consen 325 EWKFDGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAHDDEISGLSVNIQTPGLLSTASTDKVVKLWKFD 404 (463)
T ss_pred eEEeccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEeccCCcceEEecCCCCcceeeccccceEEEEeec
Confidence 3345688999999997654 5677889999999999864 3 45778999999999999887777666555566666665
Q ss_pred CCC
Q 018806 327 SKP 329 (350)
Q Consensus 327 ~~~ 329 (350)
...
T Consensus 405 ~~~ 407 (463)
T KOG0270|consen 405 VDS 407 (463)
T ss_pred CCC
Confidence 443
No 144
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.76 E-value=2.4e-16 Score=138.42 Aligned_cols=208 Identities=16% Similarity=0.236 Sum_probs=152.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|.+++++.+.+.||.+-.+|.|.||++.. ..-....+..+.+..|.+++|++. .+|++++.+|.|.-||+...+...
T Consensus 27 ~I~slA~s~kS~~lAvsRt~g~IEiwN~~~-~w~~~~vi~g~~drsIE~L~W~e~-~RLFS~g~sg~i~EwDl~~lk~~~ 104 (691)
T KOG2048|consen 27 EIVSLAYSHKSNQLAVSRTDGNIEIWNLSN-NWFLEPVIHGPEDRSIESLAWAEG-GRLFSSGLSGSITEWDLHTLKQKY 104 (691)
T ss_pred ceEEEEEeccCCceeeeccCCcEEEEccCC-CceeeEEEecCCCCceeeEEEccC-CeEEeecCCceEEEEecccCceeE
Confidence 699999999999999999999999999964 233334444456788999999955 899999999999999998444332
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee---eecCCCe
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI---RRGFGGL 257 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~---~~~~~~v 257 (350)
.+ ... .+.|++++.+|.+..++.++.| |.+..++...+..... ...++.+
T Consensus 105 ~~-------------------------d~~-gg~IWsiai~p~~~~l~Igcdd-Gvl~~~s~~p~~I~~~r~l~rq~sRv 157 (691)
T KOG2048|consen 105 NI-------------------------DSN-GGAIWSIAINPENTILAIGCDD-GVLYDFSIGPDKITYKRSLMRQKSRV 157 (691)
T ss_pred Ee-------------------------cCC-CcceeEEEeCCccceEEeecCC-ceEEEEecCCceEEEEeecccccceE
Confidence 22 222 4799999999999999999998 7888888877765432 2345889
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-----cc---c-CCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC--
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-----WS---S-TSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA-- 326 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-----~~---~-~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~-- 326 (350)
.++.|+|++..|+.|+.||.|++||..++.... +. . ...-|+++.|-.++. |++| |..+.+..|+..
T Consensus 158 Lslsw~~~~~~i~~Gs~Dg~Iriwd~~~~~t~~~~~~~~d~l~k~~~~iVWSv~~Lrd~t-I~sg-DS~G~V~FWd~~~g 235 (691)
T KOG2048|consen 158 LSLSWNPTGTKIAGGSIDGVIRIWDVKSGQTLHIITMQLDRLSKREPTIVWSVLFLRDST-IASG-DSAGTVTFWDSIFG 235 (691)
T ss_pred EEEEecCCccEEEecccCceEEEEEcCCCceEEEeeecccccccCCceEEEEEEEeecCc-EEEe-cCCceEEEEcccCc
Confidence 999999999999999999999999999887633 21 1 233578998887664 4434 333344444332
Q ss_pred CCCCCCceeeccc
Q 018806 327 SKPPSLDAHLLPV 339 (350)
Q Consensus 327 ~~~~~~~~~~~~v 339 (350)
....+...|..-|
T Consensus 236 TLiqS~~~h~adV 248 (691)
T KOG2048|consen 236 TLIQSHSCHDADV 248 (691)
T ss_pred chhhhhhhhhcce
Confidence 2223444454444
No 145
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.75 E-value=7.4e-16 Score=139.13 Aligned_cols=215 Identities=18% Similarity=0.204 Sum_probs=145.5
Q ss_pred cCeeEEEEecCCCEEEEEEC---CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCc--EEEEec
Q 018806 100 VDLQGVSWHQHKHIVAFISG---STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGG--ICIWAP 173 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~---d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~--v~iwd~ 173 (350)
..+.+.+|+|||+.|++.+. +..|.+|++.. +.. ..+ ..+.+.+...+|+|||+++++... ++. |++||+
T Consensus 202 ~~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~--g~~-~~l-~~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~ 277 (435)
T PRK05137 202 SLVLTPRFSPNRQEITYMSYANGRPRVYLLDLET--GQR-ELV-GNFPGMTFAPRFSPDGRKVVMSLSQGGNTDIYTMDL 277 (435)
T ss_pred CCeEeeEECCCCCEEEEEEecCCCCEEEEEECCC--CcE-EEe-ecCCCcccCcEECCCCCEEEEEEecCCCceEEEEEC
Confidence 47899999999999998764 46899999854 432 223 245567889999999988876554 444 666676
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIR 251 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~ 251 (350)
..+. .. .+..+. .......|+|||+.|++.+..+| .|++||+.++....+.
T Consensus 278 ~~~~-~~-------------------------~Lt~~~-~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~~~~~lt 330 (435)
T PRK05137 278 RSGT-TT-------------------------RLTDSP-AIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGSNPRRIS 330 (435)
T ss_pred CCCc-eE-------------------------EccCCC-CccCceeEcCCCCEEEEEECCCCCCeEEEEECCCCCeEEee
Confidence 6322 11 122222 35667899999999998875433 6888898887766666
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecC---CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC-----eEEEEE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFD---GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS-----LTLGSI 323 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~-----~~~~~~ 323 (350)
.+.+.+....|+|||++|+..+.+ ..|.+||+.++....+.. ...+..+.|+|||++|++..... ..++.+
T Consensus 331 ~~~~~~~~~~~SpdG~~ia~~~~~~~~~~i~~~d~~~~~~~~lt~-~~~~~~p~~spDG~~i~~~~~~~~~~~~~~L~~~ 409 (435)
T PRK05137 331 FGGGRYSTPVWSPRGDLIAFTKQGGGQFSIGVMKPDGSGERILTS-GFLVEGPTWAPNGRVIMFFRQTPGSGGAPKLYTV 409 (435)
T ss_pred cCCCcccCeEECCCCCEEEEEEcCCCceEEEEEECCCCceEeccC-CCCCCCCeECCCCCEEEEEEccCCCCCcceEEEE
Confidence 555667778999999999876543 368889987665544432 33567889999999998876322 368888
Q ss_pred EeCCCCCCCceeecccccceeec
Q 018806 324 HFASKPPSLDAHLLPVDLPDIVS 346 (350)
Q Consensus 324 ~~~~~~~~~~~~~~~v~~~~~~~ 346 (350)
++.......-.....+..|.+.+
T Consensus 410 dl~g~~~~~l~~~~~~~~p~Wsp 432 (435)
T PRK05137 410 DLTGRNEREVPTPGDASDPAWSP 432 (435)
T ss_pred ECCCCceEEccCCCCccCcccCC
Confidence 87654432111222344555543
No 146
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.75 E-value=1.3e-16 Score=133.58 Aligned_cols=203 Identities=16% Similarity=0.226 Sum_probs=146.5
Q ss_pred CccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCC
Q 018806 98 PEVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSY 175 (350)
Q Consensus 98 ~~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~ 175 (350)
+...|-+++|+..- +.||+||.|.+|.+||++. +++...+ ..|.+.|.++.|+|... .+++++.|++|.+.|.+.
T Consensus 242 HTdavl~Ls~n~~~~nVLaSgsaD~TV~lWD~~~--g~p~~s~-~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~ 318 (463)
T KOG0270|consen 242 HTDAVLALSWNRNFRNVLASGSADKTVKLWDVDT--GKPKSSI-THHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRD 318 (463)
T ss_pred chHHHHHHHhccccceeEEecCCCceEEEEEcCC--CCcceeh-hhcCCceeEEEecCCCceEEEeccccceEEeeeccC
Confidence 34467788888764 6889999999999999965 6665555 36899999999999754 556666699999999985
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-Cce-eeeec
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-LGT-PIRRG 253 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-~~~-~~~~~ 253 (350)
..+..... +. .+.|-.++|.|.....+.++.|+|+++-+|++.. ++. .+..|
T Consensus 319 ~~~s~~~w------------------k~--------~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AH 372 (463)
T KOG0270|consen 319 PSNSGKEW------------------KF--------DGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAH 372 (463)
T ss_pred ccccCceE------------------Ee--------ccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEec
Confidence 33322211 11 3689999999987776666666699999999986 444 36679
Q ss_pred CCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCceeccccC---CCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCC
Q 018806 254 FGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTSEPWSST---SGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKP 329 (350)
Q Consensus 254 ~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~~~~~~~---~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~ 329 (350)
.++|.++++++.- .++++++.|+.|++|++..........| -+...++++.|+-.++++.++....+..|++....
T Consensus 373 d~~ISgl~~n~~~p~~l~t~s~d~~Vklw~~~~~~~~~v~~~~~~~~rl~c~~~~~~~a~~la~GG~k~~~~vwd~~~~~ 452 (463)
T KOG0270|consen 373 DDEISGLSVNIQTPGLLSTASTDKVVKLWKFDVDSPKSVKEHSFKLGRLHCFALDPDVAFTLAFGGEKAVLRVWDIFTNS 452 (463)
T ss_pred cCCcceEEecCCCCcceeeccccceEEEEeecCCCCcccccccccccceeecccCCCcceEEEecCccceEEEeecccCh
Confidence 9999999999864 4678999999999999976554333222 23467788888877655544333345555555443
No 147
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.75 E-value=5.5e-17 Score=141.55 Aligned_cols=243 Identities=18% Similarity=0.262 Sum_probs=156.5
Q ss_pred CCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeE-ecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEec
Q 018806 96 LLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACI-LTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAP 173 (350)
Q Consensus 96 ~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~-~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~ 173 (350)
++|-..|..+.|-|-..+|++++.|.++++||++. ...... +..+|.+.|.+++|.|.+..+++.|. ||.|.|||+
T Consensus 97 ~aH~nAifDl~wapge~~lVsasGDsT~r~Wdvk~--s~l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGgRDg~illWD~ 174 (720)
T KOG0321|consen 97 LAHKNAIFDLKWAPGESLLVSASGDSTIRPWDVKT--SRLVGGRLNLGHTGSVKSECFMPTNPAVFCTGGRDGEILLWDC 174 (720)
T ss_pred ccccceeEeeccCCCceeEEEccCCceeeeeeecc--ceeecceeecccccccchhhhccCCCcceeeccCCCcEEEEEE
Confidence 45566899999999667899999999999999964 322222 34689999999999999777666555 899999999
Q ss_pred CCCCCCceeecccccccceecC--CCCCc-eEEeeeccCCCCCceee---EEECCCCCeEEEEEe-CCCeEEEEeCCCCC
Q 018806 174 SYPGNAASVRSGAASFLGALSR--GPGTR-WTLVDFLRSQNGEQITA---LSWGPDGRYLASASY-ESSSFTIWDVAQGL 246 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~--~~~~~-~~~~~~~~~~~~~~v~~---~~~sp~g~~l~~~~~-d~g~i~iwd~~~~~ 246 (350)
+... ...+............. .+... -.-...-..+. ..|.+ +.+..|...|++++. | +.|++||++...
T Consensus 175 R~n~-~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s-~ti~ssvTvv~fkDe~tlaSaga~D-~~iKVWDLRk~~ 251 (720)
T KOG0321|consen 175 RCNG-VDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAAS-NTIFSSVTVVLFKDESTLASAGAAD-STIKVWDLRKNY 251 (720)
T ss_pred eccc-hhhHHHHhhhhhccccCCCCCCchhhcccccccccc-CceeeeeEEEEEeccceeeeccCCC-cceEEEeecccc
Confidence 8444 11111000000000000 00000 00001111222 34444 556678889999888 6 799999999764
Q ss_pred cee---------eeec---CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCC------CeEEEEEcCCCC
Q 018806 247 GTP---------IRRG---FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSG------FVTGATWDPEGR 308 (350)
Q Consensus 247 ~~~---------~~~~---~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~------~v~~~~~s~~g~ 308 (350)
... +..+ ..++.++.....|.+|++.+.|+.|++||+.+........+.+ .+. -..+||+.
T Consensus 252 ~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsCtD~sIy~ynm~s~s~sP~~~~sg~~~~sf~vk-s~lSpd~~ 330 (720)
T KOG0321|consen 252 TAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASCTDNSIYFYNMRSLSISPVAEFSGKLNSSFYVK-SELSPDDC 330 (720)
T ss_pred cccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEecCCcEEEEeccccCcCchhhccCcccceeeee-eecCCCCc
Confidence 321 1112 2457778888889999888889999999999877643332211 222 24699999
Q ss_pred EEEEEE-CCCeEEEEEEeCCCCC-CCceeeccccccee
Q 018806 309 MILLAF-AGSLTLGSIHFASKPP-SLDAHLLPVDLPDI 344 (350)
Q Consensus 309 ~l~~~~-~~~~~~~~~~~~~~~~-~~~~~~~~v~~~~~ 344 (350)
+|++|+ +...++|.+.-...++ .+.+|...|+...+
T Consensus 331 ~l~SgSsd~~ayiw~vs~~e~~~~~l~Ght~eVt~V~w 368 (720)
T KOG0321|consen 331 SLLSGSSDEQAYIWVVSSPEAPPALLLGHTREVTTVRW 368 (720)
T ss_pred eEeccCCCcceeeeeecCccCChhhhhCcceEEEEEee
Confidence 999987 6667777776655554 66688777765443
No 148
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.75 E-value=1.1e-16 Score=134.76 Aligned_cols=194 Identities=15% Similarity=0.226 Sum_probs=145.3
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.+.....||++++||..+..|.|.|.... ++..+..+ ...+.|..++|+.+++.+++++.+|.|.+||++......
T Consensus 305 ~~e~FeVShd~~fia~~G~~G~I~lLhak--T~eli~s~--KieG~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~ 380 (514)
T KOG2055|consen 305 SMERFEVSHDSNFIAIAGNNGHIHLLHAK--TKELITSF--KIEGVVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLH 380 (514)
T ss_pred hhheeEecCCCCeEEEcccCceEEeehhh--hhhhhhee--eeccEEeeEEEecCCcEEEEEcCCceEEEEecCCcceEE
Confidence 47778889999999999999999998874 35544444 356789999999999999999999999999999553322
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC----Cceeee---ec
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG----LGTPIR---RG 253 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~----~~~~~~---~~ 253 (350)
. +.....-.-++++.|++|.+||+|+.. |.|.|||.++. .+.++. .-
T Consensus 381 r-------------------------f~D~G~v~gts~~~S~ng~ylA~GS~~-GiVNIYd~~s~~~s~~PkPik~~dNL 434 (514)
T KOG2055|consen 381 R-------------------------FVDDGSVHGTSLCISLNGSYLATGSDS-GIVNIYDGNSCFASTNPKPIKTVDNL 434 (514)
T ss_pred E-------------------------EeecCccceeeeeecCCCceEEeccCc-ceEEEeccchhhccCCCCchhhhhhh
Confidence 2 222111123567788999999999988 89999997653 222222 33
Q ss_pred CCCeEEEEEcCCCCEEEEEec--CCeEEEEeCCCCce-eccc---cCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 254 FGGLSILKWSPTGDYFFAAKF--DGTFYLWETNTWTS-EPWS---STSGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~--d~~v~iwd~~~~~~-~~~~---~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
...|.++.|++|+++||.++. +..+++-.+.+.+. ..+. ..-+.|++|+|||.|-+|++|. .+...+|.++
T Consensus 435 tt~Itsl~Fn~d~qiLAiaS~~~knalrLVHvPS~TVFsNfP~~n~~vg~vtc~aFSP~sG~lAvGNe~grv~l~kL~ 512 (514)
T KOG2055|consen 435 TTAITSLQFNHDAQILAIASRVKKNALRLVHVPSCTVFSNFPTSNTKVGHVTCMAFSPNSGYLAVGNEAGRVHLFKLH 512 (514)
T ss_pred heeeeeeeeCcchhhhhhhhhccccceEEEeccceeeeccCCCCCCcccceEEEEecCCCceEEeecCCCceeeEeec
Confidence 578999999999999987765 66899998887766 2333 2345789999999999999997 4445555543
No 149
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.75 E-value=1.4e-17 Score=154.23 Aligned_cols=203 Identities=17% Similarity=0.327 Sum_probs=151.5
Q ss_pred ccCeeEEEEecCCC-EEEEEECCCeEEEEEccCCCCCceeEe-cCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCC
Q 018806 99 EVDLQGVSWHQHKH-IVAFISGSTQVIVRDYEDSEGKDACIL-TSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSY 175 (350)
Q Consensus 99 ~~~V~~v~~sp~g~-~la~~s~d~~i~iw~~~~~~~~~~~~~-~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~ 175 (350)
...|..+.|++.+. +||+|+.||.|.|||++.. +..... .......|.+++|+..-+++++++.. |.+.|||++.
T Consensus 116 ~G~V~gLDfN~~q~nlLASGa~~geI~iWDlnn~--~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~ 193 (1049)
T KOG0307|consen 116 TGPVLGLDFNPFQGNLLASGADDGEILIWDLNKP--ETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRK 193 (1049)
T ss_pred CCceeeeeccccCCceeeccCCCCcEEEeccCCc--CCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccC
Confidence 34599999999765 9999999999999999642 222222 22345789999999887888887775 8999999995
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEEEEeCCC--eEEEEeCCCCC--ceee
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLASASYESS--SFTIWDVAQGL--GTPI 250 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g--~i~iwd~~~~~--~~~~ 250 (350)
.+.+-.+... + ....+..++|+|+. ..|++++.|++ .|.+||++... ...+
T Consensus 194 ~~pii~ls~~-----------------------~-~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~assP~k~~ 249 (1049)
T KOG0307|consen 194 KKPIIKLSDT-----------------------P-GRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFASSPLKIL 249 (1049)
T ss_pred CCcccccccC-----------------------C-CccceeeeeeCCCCceeeeeecCCCCCceeEeecccccCCchhhh
Confidence 5433222211 1 11458899999975 45666666643 79999988543 2334
Q ss_pred eecCCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCE-EEEEE-CCCeEEEEEEeC
Q 018806 251 RRGFGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRM-ILLAF-AGSLTLGSIHFA 326 (350)
Q Consensus 251 ~~~~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~-l~~~~-~~~~~~~~~~~~ 326 (350)
..|..+|.++.|++.+ ++|++++.|+.|.+||.++++.. .+.....++..+.|+|...- +++++ ++.+.|+.+.-.
T Consensus 250 ~~H~~GilslsWc~~D~~lllSsgkD~~ii~wN~~tgEvl~~~p~~~nW~fdv~w~pr~P~~~A~asfdgkI~I~sl~~~ 329 (1049)
T KOG0307|consen 250 EGHQRGILSLSWCPQDPRLLLSSGKDNRIICWNPNTGEVLGELPAQGNWCFDVQWCPRNPSVMAAASFDGKISIYSLQGT 329 (1049)
T ss_pred cccccceeeeccCCCCchhhhcccCCCCeeEecCCCceEeeecCCCCcceeeeeecCCCcchhhhheeccceeeeeeecC
Confidence 5789999999999976 78899999999999999999984 56667889999999998874 44444 777777777654
Q ss_pred C
Q 018806 327 S 327 (350)
Q Consensus 327 ~ 327 (350)
+
T Consensus 330 ~ 330 (1049)
T KOG0307|consen 330 D 330 (1049)
T ss_pred C
Confidence 4
No 150
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.75 E-value=5.5e-16 Score=139.78 Aligned_cols=214 Identities=16% Similarity=0.188 Sum_probs=144.7
Q ss_pred cCeeEEEEecCCCEEEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CC--cEEEEec
Q 018806 100 VDLQGVSWHQHKHIVAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KG--GICIWAP 173 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~--~v~iwd~ 173 (350)
..+.+.+|+|||+.|++.+.+ ..|.+|++.. +... .+. ...+...+++|+|||+++++... ++ .|++||+
T Consensus 204 ~~v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~--g~~~-~l~-~~~g~~~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~ 279 (433)
T PRK04922 204 EPILSPAWSPDGKKLAYVSFERGRSAIYVQDLAT--GQRE-LVA-SFRGINGAPSFSPDGRRLALTLSRDGNPEIYVMDL 279 (433)
T ss_pred CccccccCCCCCCEEEEEecCCCCcEEEEEECCC--CCEE-Eec-cCCCCccCceECCCCCEEEEEEeCCCCceEEEEEC
Confidence 368899999999999988743 4688899854 3322 222 33445668899999988876543 44 5888888
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIR 251 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~ 251 (350)
..+. ... +..+. .....++|+|||+.|++++...| .|+++|+.+++...+.
T Consensus 280 ~~g~-~~~-------------------------lt~~~-~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g~~~~lt 332 (433)
T PRK04922 280 GSRQ-LTR-------------------------LTNHF-GIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGGSAERLT 332 (433)
T ss_pred CCCC-eEE-------------------------CccCC-CCccceEECCCCCEEEEEECCCCCceEEEEECCCCCeEEee
Confidence 7332 111 22222 34567899999999998875434 4777788777665554
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecCC---eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeC
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFDG---TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFA 326 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d~---~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~ 326 (350)
........++|+|||++|+..+.++ .|++||+.+++...+.. ......+.|+|||++|++... +...++.++..
T Consensus 333 ~~g~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~~g~~~~Lt~-~~~~~~p~~spdG~~i~~~s~~~g~~~L~~~~~~ 411 (433)
T PRK04922 333 FQGNYNARASVSPDGKKIAMVHGSGGQYRIAVMDLSTGSVRTLTP-GSLDESPSFAPNGSMVLYATREGGRGVLAAVSTD 411 (433)
T ss_pred cCCCCccCEEECCCCCEEEEEECCCCceeEEEEECCCCCeEECCC-CCCCCCceECCCCCEEEEEEecCCceEEEEEECC
Confidence 4444455789999999998765433 69999999888765543 334567899999999988763 34678888886
Q ss_pred CCCC-CCceeecccccceee
Q 018806 327 SKPP-SLDAHLLPVDLPDIV 345 (350)
Q Consensus 327 ~~~~-~~~~~~~~v~~~~~~ 345 (350)
+... .+..+...+..|.++
T Consensus 412 g~~~~~l~~~~g~~~~p~ws 431 (433)
T PRK04922 412 GRVRQRLVSADGEVREPAWS 431 (433)
T ss_pred CCceEEcccCCCCCCCCccC
Confidence 5433 343344445555544
No 151
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.75 E-value=1.1e-16 Score=140.98 Aligned_cols=205 Identities=13% Similarity=0.116 Sum_probs=148.2
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeE-EEEee-CCCeEEEEecCCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKV-LEWRP-NGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~-~~~sp-~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
|..+++.+. .+++++|.||++++|+-..+.-... ....+|.+.|.. +++-+ ++.+++.++.|.++.+|...... +
T Consensus 17 Vr~v~~~~~-~~i~s~sRd~t~~vw~~~~~~~l~~-~~~~~~~g~i~~~i~y~e~~~~~l~~g~~D~~i~v~~~~~~~-P 93 (745)
T KOG0301|consen 17 VRAVAVTDG-VCIISGSRDGTVKVWAKKGKQYLET-HAFEGPKGFIANSICYAESDKGRLVVGGMDTTIIVFKLSQAE-P 93 (745)
T ss_pred hheeEecCC-eEEeecCCCCceeeeeccCcccccc-eecccCcceeeccceeccccCcceEeecccceEEEEecCCCC-c
Confidence 566665544 4788999999999999743222211 223456666666 77775 44568888889999999988333 2
Q ss_pred ceeecccccccce---------ecCCCCCceEEee------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC
Q 018806 180 ASVRSGAASFLGA---------LSRGPGTRWTLVD------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 180 ~~~~~~~~~~~~~---------~~~~~~~~~~~~~------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~ 244 (350)
..+..++...+.. ++.+.|...++|. .+.+|. ..|++++.-|++ .+++++.|+ +|++|.-.+
T Consensus 94 ~~~LkgH~snVC~ls~~~~~~~iSgSWD~TakvW~~~~l~~~l~gH~-asVWAv~~l~e~-~~vTgsaDK-tIklWk~~~ 170 (745)
T KOG0301|consen 94 LYTLKGHKSNVCSLSIGEDGTLISGSWDSTAKVWRIGELVYSLQGHT-ASVWAVASLPEN-TYVTGSADK-TIKLWKGGT 170 (745)
T ss_pred hhhhhccccceeeeecCCcCceEecccccceEEecchhhhcccCCcc-hheeeeeecCCC-cEEeccCcc-eeeeccCCc
Confidence 2222333322222 4445555544443 678897 799999999987 888999995 999998632
Q ss_pred CCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 245 GLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 245 ~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
....+.+|...|+.+++-+++. +++++.||.|++|++...-.....+|...+.+++..+++..+++++
T Consensus 171 -~l~tf~gHtD~VRgL~vl~~~~-flScsNDg~Ir~w~~~ge~l~~~~ghtn~vYsis~~~~~~~Ivs~g 238 (745)
T KOG0301|consen 171 -LLKTFSGHTDCVRGLAVLDDSH-FLSCSNDGSIRLWDLDGEVLLEMHGHTNFVYSISMALSDGLIVSTG 238 (745)
T ss_pred -hhhhhccchhheeeeEEecCCC-eEeecCCceEEEEeccCceeeeeeccceEEEEEEecCCCCeEEEec
Confidence 2345667999999999988764 7788899999999996555678899999999999888888888775
No 152
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.75 E-value=5.6e-16 Score=137.12 Aligned_cols=242 Identities=16% Similarity=0.164 Sum_probs=156.4
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC-----------CCeEEEEecCCcEE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN-----------GGRSLSVGCKGGIC 169 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-----------~~~l~~~~~d~~v~ 169 (350)
+.-++.|++...+|.+..+|..++|||+...+..-.+.....|...|+++.--|- ...+++++.|++|+
T Consensus 326 D~IA~~Fdet~~klscVYndhSlYvWDvrD~~kvgk~~s~lyHS~ciW~Ve~~p~nv~~~~~aclp~~cF~TCSsD~TIR 405 (1080)
T KOG1408|consen 326 DAIACQFDETTDKLSCVYNDHSLYVWDVRDVNKVGKCSSMLYHSACIWDVENLPCNVHSPTAACLPRGCFTTCSSDGTIR 405 (1080)
T ss_pred ceeEEEecCCCceEEEEEcCceEEEEeccccccccceeeeeeccceeeeeccccccccCcccccCCccceeEecCCCcEE
Confidence 4678899999999999999999999999754432222222357788887766541 13588899999999
Q ss_pred EEecCCCCCCceeeccccccc-ceecCCCCC------------ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCe
Q 018806 170 IWAPSYPGNAASVRSGAASFL-GALSRGPGT------------RWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSS 236 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~-~~~~~~~~~------------~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~ 236 (350)
+|++....+-......-.+.. ..+....+. .-.....+.+. ..+.+++.||+|++|++|..- |+
T Consensus 406 lW~l~~ctnn~vyrRNils~~l~ki~y~d~~~q~~~d~~~~~fdka~~s~~d~r--~G~R~~~vSp~gqhLAsGDr~-Gn 482 (1080)
T KOG1408|consen 406 LWDLAFCTNNQVYRRNILSANLSKIPYEDSTQQIMHDASAGIFDKALVSTCDSR--FGFRALAVSPDGQHLASGDRG-GN 482 (1080)
T ss_pred EeecccccccceeecccchhhhhcCccccCchhhhhhccCCcccccchhhcCcc--cceEEEEECCCcceecccCcc-Cc
Confidence 999985333222111100000 000000000 00011112221 367777777777777777666 67
Q ss_pred EEEEeCCCC-----------------------------------------------------------------------
Q 018806 237 FTIWDVAQG----------------------------------------------------------------------- 245 (350)
Q Consensus 237 i~iwd~~~~----------------------------------------------------------------------- 245 (350)
+++|++..-
T Consensus 483 lrVy~Lq~l~~~~~~eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rny~l~qtld~HSssITsvKFa~~gln~ 562 (1080)
T KOG1408|consen 483 LRVYDLQELEYTCFMEAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRNYDLVQTLDGHSSSITSVKFACNGLNR 562 (1080)
T ss_pred eEEEEehhhhhhhheecccceeEEEeecCchhhhHhhhhccCCceEEEEecccccchhhhhcccccceeEEEEeecCCce
Confidence 777776432
Q ss_pred ----------------C----ceeee-e----cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc----cCCC
Q 018806 246 ----------------L----GTPIR-R----GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS----STSG 296 (350)
Q Consensus 246 ----------------~----~~~~~-~----~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~----~~~~ 296 (350)
+ ...+. . .+..++.++..|..+++++++.|+.|+|||+++++....+ .|++
T Consensus 563 ~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~sgKq~k~FKgs~~~eG 642 (1080)
T KOG1408|consen 563 KMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRNIRIFDIESGKQVKSFKGSRDHEG 642 (1080)
T ss_pred EEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEecccceEEEeccccceeeeecccccCCC
Confidence 0 00000 0 1134677888888899999999999999999999985433 5677
Q ss_pred CeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCceeecccccceee
Q 018806 297 FVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLDAHLLPVDLPDIV 345 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~ 345 (350)
....+...|.|.||++++ ++...++++.-........+|.-.|++..|.
T Consensus 643 ~lIKv~lDPSgiY~atScsdktl~~~Df~sgEcvA~m~GHsE~VTG~kF~ 692 (1080)
T KOG1408|consen 643 DLIKVILDPSGIYLATSCSDKTLCFVDFVSGECVAQMTGHSEAVTGVKFL 692 (1080)
T ss_pred ceEEEEECCCccEEEEeecCCceEEEEeccchhhhhhcCcchheeeeeec
Confidence 888899999999999988 5555555555555566888999888876654
No 153
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.74 E-value=5.5e-16 Score=124.67 Aligned_cols=183 Identities=16% Similarity=0.147 Sum_probs=138.3
Q ss_pred EEEEECCCeEEEEEccCCC----CC-ce----eEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeec
Q 018806 114 VAFISGSTQVIVRDYEDSE----GK-DA----CILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRS 184 (350)
Q Consensus 114 la~~s~d~~i~iw~~~~~~----~~-~~----~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~ 184 (350)
|++|++...|.-++++... .. .. .-....|.++|++++.+ +.++++++.|.+|+|||+........
T Consensus 4 iIvGtYE~~i~Gf~l~~~~~~~~~s~~~~l~~lF~~~aH~~sitavAVs--~~~~aSGssDetI~IYDm~k~~qlg~--- 78 (362)
T KOG0294|consen 4 IIVGTYEHVILGFKLDPEPKGCTDSVKPTLKPLFAFSAHAGSITALAVS--GPYVASGSSDETIHIYDMRKRKQLGI--- 78 (362)
T ss_pred EEEeeeeeEEEEEEeccCccccccccceeeeccccccccccceeEEEec--ceeEeccCCCCcEEEEeccchhhhcc---
Confidence 6677888777666664322 01 11 11123689999999986 57888888899999999985544332
Q ss_pred ccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCC--eEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEE
Q 018806 185 GAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGR--YLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILK 261 (350)
Q Consensus 185 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~--~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~ 261 (350)
+..|. +.|+++.|.+.-. +|++++.| |.|.+|+...-.... +..|.+.|+.++
T Consensus 79 ----------------------ll~Ha-gsitaL~F~~~~S~shLlS~sdD-G~i~iw~~~~W~~~~slK~H~~~Vt~ls 134 (362)
T KOG0294|consen 79 ----------------------LLSHA-GSITALKFYPPLSKSHLLSGSDD-GHIIIWRVGSWELLKSLKAHKGQVTDLS 134 (362)
T ss_pred ----------------------eeccc-cceEEEEecCCcchhheeeecCC-CcEEEEEcCCeEEeeeecccccccceeE
Confidence 44454 7999999998765 89999999 799999998876554 667888899999
Q ss_pred EcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 262 WSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 262 ~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.+|.|++.++.+.|+.++.||+-.|+......-....+.+.|+|.|.++++...+.+.+|.++.
T Consensus 135 iHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~ 198 (362)
T KOG0294|consen 135 IHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDN 198 (362)
T ss_pred ecCCCceEEEEcCCceeeeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEeccc
Confidence 9999999999999999999999988874444334445568999999988888766666666554
No 154
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.74 E-value=7.4e-17 Score=135.58 Aligned_cols=189 Identities=17% Similarity=0.233 Sum_probs=138.6
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
+.+|.++.|+|.. ..+++.|.||+|++-|++......+.... .....+.++.|+.+...++++..-|.+.+||++.++
T Consensus 234 s~~Vs~l~F~P~n~s~i~ssSyDGtiR~~D~~~~i~e~v~s~~-~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~ 312 (498)
T KOG4328|consen 234 SGPVSGLKFSPANTSQIYSSSYDGTIRLQDFEGNISEEVLSLD-TDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDG 312 (498)
T ss_pred CccccceEecCCChhheeeeccCceeeeeeecchhhHHHhhcC-ccceeeeeccccCCCccEEEeecccceEEEEeecCC
Confidence 4469999999955 67888899999999999754333333331 234567788898886777777666899999999665
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCCCc-----eeee
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVAQGLG-----TPIR 251 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~~~-----~~~~ 251 (350)
.... .+.-|. ..|.+++++|-. .+|++++.| ++.+|||++.-.. ....
T Consensus 313 s~~~------------------------~~~lh~-kKI~sv~~NP~~p~~laT~s~D-~T~kIWD~R~l~~K~sp~lst~ 366 (498)
T KOG4328|consen 313 SEYE------------------------NLRLHK-KKITSVALNPVCPWFLATASLD-QTAKIWDLRQLRGKASPFLSTL 366 (498)
T ss_pred ccch------------------------hhhhhh-cccceeecCCCCchheeecccC-cceeeeehhhhcCCCCcceecc
Confidence 4322 234454 599999999965 567888999 5999999986432 2345
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCC----CCceeccccCCC------CeEEEEEcCCCCEEEEEE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETN----TWTSEPWSSTSG------FVTGATWDPEGRMILLAF 314 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~----~~~~~~~~~~~~------~v~~~~~s~~g~~l~~~~ 314 (350)
.|...|.+..|||+|-.|++.+.|..|+|||.. .-.......|.. .....+|.|+..+++++.
T Consensus 367 ~HrrsV~sAyFSPs~gtl~TT~~D~~IRv~dss~~sa~~~p~~~I~Hn~~t~RwlT~fKA~W~P~~~li~vg~ 439 (498)
T KOG4328|consen 367 PHRRSVNSAYFSPSGGTLLTTCQDNEIRVFDSSCISAKDEPLGTIPHNNRTGRWLTPFKAAWDPDYNLIVVGR 439 (498)
T ss_pred cccceeeeeEEcCCCCceEeeccCCceEEeecccccccCCccceeeccCcccccccchhheeCCCccEEEEec
Confidence 688899999999998789999999999999984 222222333322 234678999999999884
No 155
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.74 E-value=2.5e-16 Score=126.83 Aligned_cols=182 Identities=15% Similarity=0.249 Sum_probs=125.3
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC--ceee-cccccccceecCCC-----------CCceEEeee
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA--ASVR-SGAASFLGALSRGP-----------GTRWTLVDF 206 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~--~~~~-~~~~~~~~~~~~~~-----------~~~~~~~~~ 206 (350)
.+|.+.|++++|+.||+.|++++.|+.|++|+++.-.+. ..+. ...........+.+ .+++.+...
T Consensus 83 KgH~~~vt~~~FsSdGK~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~dhpT~V~FapDc~s~vv~~~~g~~l~vyk~ 162 (420)
T KOG2096|consen 83 KGHKKEVTDVAFSSDGKKLATISGDRSIRLWDVRDFENKEHRCIRQNVEYDHPTRVVFAPDCKSVVVSVKRGNKLCVYKL 162 (420)
T ss_pred hccCCceeeeEEcCCCceeEEEeCCceEEEEecchhhhhhhhHhhccccCCCceEEEECCCcceEEEEEccCCEEEEEEe
Confidence 589999999999999999999999999999998721110 0000 00000111111211 112221111
Q ss_pred --------------------ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce-eeeecCCCeEEEEEcCC
Q 018806 207 --------------------LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT-PIRRGFGGLSILKWSPT 265 (350)
Q Consensus 207 --------------------~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~~v~~~~~sp~ 265 (350)
-+.| ...+..+-..-.+++|++++.|. +|.+|+++ |+.. .+......-+..+.||+
T Consensus 163 ~K~~dG~~~~~~v~~D~~~f~~kh-~v~~i~iGiA~~~k~imsas~dt-~i~lw~lk-Gq~L~~idtnq~~n~~aavSP~ 239 (420)
T KOG2096|consen 163 VKKTDGSGSHHFVHIDNLEFERKH-QVDIINIGIAGNAKYIMSASLDT-KICLWDLK-GQLLQSIDTNQSSNYDAAVSPD 239 (420)
T ss_pred eecccCCCCcccccccccccchhc-ccceEEEeecCCceEEEEecCCC-cEEEEecC-CceeeeeccccccccceeeCCC
Confidence 1112 23555666677889999999996 99999999 5443 34444566777899999
Q ss_pred CCEEEEEecCCeEEEEeCC---CCce------eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 266 GDYFFAAKFDGTFYLWETN---TWTS------EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 266 g~~l~~~~~d~~v~iwd~~---~~~~------~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
|++|++++.--.|++|..- .|+. .++.+|...|..++||++.+.+++.+ |+...+|+.++
T Consensus 240 GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aFsn~S~r~vtvSkDG~wriwdtdV 309 (420)
T KOG2096|consen 240 GRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAFSNSSTRAVTVSKDGKWRIWDTDV 309 (420)
T ss_pred CcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccchhheeeeeeCCCcceeEEEecCCcEEEeeccc
Confidence 9999999998999999863 3332 34679999999999999999999986 66666666554
No 156
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.74 E-value=1.4e-16 Score=128.69 Aligned_cols=197 Identities=14% Similarity=0.228 Sum_probs=143.9
Q ss_pred CeeEEEEecCC----CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCC
Q 018806 101 DLQGVSWHQHK----HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSY 175 (350)
Q Consensus 101 ~V~~v~~sp~g----~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~ 175 (350)
....++|+-+. .++|.|+.-|.|+|.|+.. ++....+ .+|...|+.+++.|+.. .+++++.|..|++|+++.
T Consensus 91 sfytcsw~yd~~~~~p~la~~G~~GvIrVid~~~--~~~~~~~-~ghG~sINeik~~p~~~qlvls~SkD~svRlwnI~~ 167 (385)
T KOG1034|consen 91 SFYTCSWSYDSNTGNPFLAAGGYLGVIRVIDVVS--GQCSKNY-RGHGGSINEIKFHPDRPQLVLSASKDHSVRLWNIQT 167 (385)
T ss_pred ceEEEEEEecCCCCCeeEEeecceeEEEEEecch--hhhccce-eccCccchhhhcCCCCCcEEEEecCCceEEEEeccC
Confidence 46778887653 4888899999999999954 4444444 58999999999999854 566666689999999995
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC---------
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL--------- 246 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~--------- 246 (350)
...... ..-+.+|. ..|.++.|+++|.+|++++.|. ++++|++...+
T Consensus 168 ~~Cv~V----------------------fGG~egHr-deVLSvD~~~~gd~i~ScGmDh-slk~W~l~~~~f~~~lE~s~ 223 (385)
T KOG1034|consen 168 DVCVAV----------------------FGGVEGHR-DEVLSVDFSLDGDRIASCGMDH-SLKLWRLNVKEFKNKLELSI 223 (385)
T ss_pred CeEEEE----------------------eccccccc-CcEEEEEEcCCCCeeeccCCcc-eEEEEecChhHHhhhhhhhc
Confidence 444322 22257786 6999999999999999999995 99999997330
Q ss_pred ------------------------------------------------------c----------------eeeeec---
Q 018806 247 ------------------------------------------------------G----------------TPIRRG--- 253 (350)
Q Consensus 247 ------------------------------------------------------~----------------~~~~~~--- 253 (350)
. ..+..+
T Consensus 224 ~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~~~~vkp~es~~Ti~~~~~~ 303 (385)
T KOG1034|consen 224 TYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEESIHNVKPPESATTILGEFDY 303 (385)
T ss_pred ccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhhhhccCCCccceeeeeEecc
Confidence 0 000000
Q ss_pred -CCCeE--EEEEcCCCCEEEEEecCCeEEEEeCCCCceec---cc--cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 254 -FGGLS--ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP---WS--STSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 254 -~~~v~--~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~---~~--~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
...++ ..+|.|-+++||.|...|.|++||++..+... +. .....|...+||.||..|+..++. ..+|.|+.
T Consensus 304 ~~c~iWfirf~~d~~~~~la~gnq~g~v~vwdL~~~ep~~~ttl~~s~~~~tVRQ~sfS~dgs~lv~vcdd-~~Vwrwdr 382 (385)
T KOG1034|consen 304 PMCDIWFIRFAFDPWQKMLALGNQSGKVYVWDLDNNEPPKCTTLTHSKSGSTVRQTSFSRDGSILVLVCDD-GTVWRWDR 382 (385)
T ss_pred CccceEEEEEeecHHHHHHhhccCCCcEEEEECCCCCCccCceEEeccccceeeeeeecccCcEEEEEeCC-CcEEEEEe
Confidence 01122 23455667889999999999999998876522 21 335678999999999999877654 47888865
No 157
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.73 E-value=6.2e-17 Score=141.30 Aligned_cols=207 Identities=14% Similarity=0.264 Sum_probs=151.1
Q ss_pred CCCccCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCc----eeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEE
Q 018806 96 LLPEVDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKD----ACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGIC 169 (350)
Q Consensus 96 ~~~~~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~----~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~ 169 (350)
+..+..|+.+.|+| |.+.||+++.||.|+||.+..+.... ...+...|...|++++|+|-.. .|++++.|.+|+
T Consensus 624 l~Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~ 703 (1012)
T KOG1445|consen 624 LFNGTLVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVASYDSTIE 703 (1012)
T ss_pred cccCceeeecccCCCChHHeeecccCceEEEEEeccCCCCcccCCcceeeecccceEEEEEecchhhhHhhhhhccceee
Confidence 44455899999999 67899999999999999987543222 1223347899999999999644 455566799999
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP 249 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~ 249 (350)
+||+..... ...+.+|. ..|.+++|||+|+.+++.+.| |+|++|+-++++..
T Consensus 704 lWDl~~~~~-------------------------~~~l~gHt-dqIf~~AWSpdGr~~AtVcKD-g~~rVy~Prs~e~p- 755 (1012)
T KOG1445|consen 704 LWDLANAKL-------------------------YSRLVGHT-DQIFGIAWSPDGRRIATVCKD-GTLRVYEPRSREQP- 755 (1012)
T ss_pred eeehhhhhh-------------------------hheeccCc-CceeEEEECCCCcceeeeecC-ceEEEeCCCCCCCc-
Confidence 999984332 33477887 699999999999999999999 79999999887543
Q ss_pred eeecCCC----eEEEEEcCCCCEEEEEecC----CeEEEEeCCCCceeccc----cCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 250 IRRGFGG----LSILKWSPTGDYFFAAKFD----GTFYLWETNTWTSEPWS----STSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 250 ~~~~~~~----v~~~~~sp~g~~l~~~~~d----~~v~iwd~~~~~~~~~~----~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
+.+..++ --.+.|.-||+++++.+.| +.|.+||.++-....+. .-...+.-..+.+|...|+.++.++
T Consensus 756 v~Eg~gpvgtRgARi~wacdgr~viv~Gfdk~SeRQv~~Y~Aq~l~~~pl~t~~lDvaps~LvP~YD~Ds~~lfltGKGD 835 (1012)
T KOG1445|consen 756 VYEGKGPVGTRGARILWACDGRIVIVVGFDKSSERQVQMYDAQTLDLRPLYTQVLDVAPSPLVPHYDYDSNVLFLTGKGD 835 (1012)
T ss_pred cccCCCCccCcceeEEEEecCcEEEEecccccchhhhhhhhhhhccCCcceeeeecccCccccccccCCCceEEEecCCC
Confidence 3333332 3467899999999877765 47889988765532221 1122233346788888888888777
Q ss_pred eEEEEEEeCCCCC
Q 018806 318 LTLGSIHFASKPP 330 (350)
Q Consensus 318 ~~~~~~~~~~~~~ 330 (350)
..++...+-...+
T Consensus 836 ~~v~~yEv~~esP 848 (1012)
T KOG1445|consen 836 RFVNMYEVIYESP 848 (1012)
T ss_pred ceEEEEEecCCCc
Confidence 7777777654433
No 158
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.73 E-value=4.2e-16 Score=125.61 Aligned_cols=201 Identities=17% Similarity=0.281 Sum_probs=152.1
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|+|.+|++|++.+|.+-+...+.||.....+--........|+..|+.++|+|..++|++++.|+.-++|....+
T Consensus 12 pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~~~~~---- 87 (361)
T KOG1523|consen 12 PITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWTQPSG---- 87 (361)
T ss_pred ceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccccCCC----
Confidence 5999999999999999999999999998754412233333579999999999999999999999999999998522
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee----e-eecCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP----I-RRGFG 255 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~----~-~~~~~ 255 (350)
++|...-.+..++ ..++++.|+|.+..+++++... .|.+|-++...-=. + ..+..
T Consensus 88 ------------------~~WkptlvLlRiN-rAAt~V~WsP~enkFAVgSgar-~isVcy~E~ENdWWVsKhikkPirS 147 (361)
T KOG1523|consen 88 ------------------GTWKPTLVLLRIN-RAATCVKWSPKENKFAVGSGAR-LISVCYYEQENDWWVSKHIKKPIRS 147 (361)
T ss_pred ------------------CeeccceeEEEec-cceeeEeecCcCceEEeccCcc-EEEEEEEecccceehhhhhCCcccc
Confidence 2444344444554 6899999999999999999885 99999877543221 1 12356
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCC-----CCc-------e-------eccccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETN-----TWT-------S-------EPWSSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~-----~~~-------~-------~~~~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
.|.++.|+|++-+|++|+.|+..+||..- ... . .++....+.+..+.|+|+|..|+..+..
T Consensus 148 tv~sldWhpnnVLlaaGs~D~k~rVfSayIK~Vdekpap~pWgsk~PFG~lm~E~~~~ggwvh~v~fs~sG~~lawv~Hd 227 (361)
T KOG1523|consen 148 TVTSLDWHPNNVLLAAGSTDGKCRVFSAYIKGVDEKPAPTPWGSKMPFGQLMSEASSSGGWVHGVLFSPSGNRLAWVGHD 227 (361)
T ss_pred ceeeeeccCCcceecccccCcceeEEEEeeeccccCCCCCCCccCCcHHHHHHhhccCCCceeeeEeCCCCCEeeEecCC
Confidence 78999999999999999999999998542 111 0 1122456789999999999999987633
Q ss_pred CeEEEEEEeC
Q 018806 317 SLTLGSIHFA 326 (350)
Q Consensus 317 ~~~~~~~~~~ 326 (350)
. .+...+-.
T Consensus 228 s-~v~~~da~ 236 (361)
T KOG1523|consen 228 S-TVSFVDAA 236 (361)
T ss_pred C-ceEEeecC
Confidence 2 34444443
No 159
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.73 E-value=3.7e-16 Score=132.74 Aligned_cols=180 Identities=18% Similarity=0.318 Sum_probs=145.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~ 178 (350)
..|+++.++-...+||+++..|.|.|..+.+ +.....+..+....|.-+.|+|..+.++...+ +|.|.+||+.....
T Consensus 122 stvt~v~YN~~DeyiAsvs~gGdiiih~~~t--~~~tt~f~~~sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp 199 (673)
T KOG4378|consen 122 STVTYVDYNNTDEYIASVSDGGDIIIHGTKT--KQKTTTFTIDSGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSP 199 (673)
T ss_pred ceeEEEEecCCcceeEEeccCCcEEEEeccc--CccccceecCCCCeEEEeecccccceeeEeeccCCeEEEEeccCCCc
Confidence 4699999999999999999999999999854 44445554455667889999999777776666 59999999983222
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLGTPIRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v 257 (350)
. ......|. .+...++|+|. ...|++.+.|. .|.+||+.............+.
T Consensus 200 ~------------------------~~~~~~Hs-AP~~gicfspsne~l~vsVG~Dk-ki~~yD~~s~~s~~~l~y~~Pl 253 (673)
T KOG4378|consen 200 I------------------------FHASEAHS-APCRGICFSPSNEALLVSVGYDK-KINIYDIRSQASTDRLTYSHPL 253 (673)
T ss_pred c------------------------cchhhhcc-CCcCcceecCCccceEEEecccc-eEEEeecccccccceeeecCCc
Confidence 1 11134454 78899999995 55678889995 9999999987776666777899
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCC
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g 307 (350)
..++|+++|.+|+.|...|.|..||++..+. ..+..|...|++++|-|.-
T Consensus 254 stvaf~~~G~~L~aG~s~G~~i~YD~R~~k~Pv~v~sah~~sVt~vafq~s~ 305 (673)
T KOG4378|consen 254 STVAFSECGTYLCAGNSKGELIAYDMRSTKAPVAVRSAHDASVTRVAFQPSP 305 (673)
T ss_pred ceeeecCCceEEEeecCCceEEEEecccCCCCceEeeecccceeEEEeeecc
Confidence 9999999999999999999999999998765 4566888899999998864
No 160
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=99.73 E-value=6e-17 Score=141.38 Aligned_cols=188 Identities=20% Similarity=0.316 Sum_probs=141.4
Q ss_pred EEecCCCEEEE--EECCCeEEEEEccCCCCCceeEecC--CCCCCeeEEEEeeC-CCeEEEEecCCcEEEEecCCCCCCc
Q 018806 106 SWHQHKHIVAF--ISGSTQVIVRDYEDSEGKDACILTS--DSQRDVKVLEWRPN-GGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 106 ~~sp~g~~la~--~s~d~~i~iw~~~~~~~~~~~~~~~--~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|+.+..++|+ ++..|.|-||+++.. |+....... .....|+.+.|.|- ..+|++++.||.|++|.+..++...
T Consensus 586 Gfcan~~rvAVPL~g~gG~iai~el~~P-GrLPDgv~p~l~Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e 664 (1012)
T KOG1445|consen 586 GFCANNKRVAVPLAGSGGVIAIYELNEP-GRLPDGVMPGLFNGTLVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPE 664 (1012)
T ss_pred ceeeccceEEEEecCCCceEEEEEcCCC-CCCCcccccccccCceeeecccCCCChHHeeecccCceEEEEEeccCCCCc
Confidence 45556667765 456789999999742 333222211 14567999999984 4567777778999999998766554
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCce-eeeecCCCeE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLGT-PIRRGFGGLS 258 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~~v~ 258 (350)
...+. ...+.+|. ..|+++.|+|- ...|++++.|. +|++||+++++.. .+.+|.+.|.
T Consensus 665 ~~~tP------------------e~~lt~h~-eKI~slRfHPLAadvLa~asyd~-Ti~lWDl~~~~~~~~l~gHtdqIf 724 (1012)
T KOG1445|consen 665 NEMTP------------------EKILTIHG-EKITSLRFHPLAADVLAVASYDS-TIELWDLANAKLYSRLVGHTDQIF 724 (1012)
T ss_pred ccCCc------------------ceeeeccc-ceEEEEEecchhhhHhhhhhccc-eeeeeehhhhhhhheeccCcCcee
Confidence 43332 34577776 69999999995 56788999995 9999999998754 5778999999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceecccc---CCCCeEEEEEcCCCCEEEEEE
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSS---TSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~---~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.++|||+|+.+|+.+.||+|++|+-++++.....+ -...-..+.|.-||+++++.+
T Consensus 725 ~~AWSpdGr~~AtVcKDg~~rVy~Prs~e~pv~Eg~gpvgtRgARi~wacdgr~viv~G 783 (1012)
T KOG1445|consen 725 GIAWSPDGRRIATVCKDGTLRVYEPRSREQPVYEGKGPVGTRGARILWACDGRIVIVVG 783 (1012)
T ss_pred EEEECCCCcceeeeecCceEEEeCCCCCCCccccCCCCccCcceeEEEEecCcEEEEec
Confidence 99999999999999999999999998876522211 123446788999999988876
No 161
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.73 E-value=1.3e-16 Score=137.46 Aligned_cols=197 Identities=16% Similarity=0.214 Sum_probs=151.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccC---CCC--CceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYED---SEG--KDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSY 175 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~---~~~--~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~ 175 (350)
.++.++|+|....|++++.|+++.+|++.. ... ......+.+|.++|.|++..+++..++++|.||+|+.|++..
T Consensus 296 ~ir~l~~~~sep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfraH~gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~ 375 (577)
T KOG0642|consen 296 CIRALAFHPSEPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRAHEGPVLCVVVPSNGEHCYSGGIDGTIRCWNLPP 375 (577)
T ss_pred hhhhhhcCCCCCeEEEeccccchhhhhhcccCCccccceeeeEEEecccCceEEEEecCCceEEEeeccCceeeeeccCC
Confidence 588889999999999999999999999921 111 122223358999999999999999999999999999999872
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc--------
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-------- 247 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-------- 247 (350)
...+.... +.-.+...+.||. ..++.+++|+....|++++.| |+++.|+......
T Consensus 376 n~dp~ds~---------------dp~vl~~~l~Ght-davw~l~~s~~~~~Llscs~D-gTvr~w~~~~~~~~~f~~~~e 438 (577)
T KOG0642|consen 376 NQDPDDSY---------------DPSVLSGTLLGHT-DAVWLLALSSTKDRLLSCSSD-GTVRLWEPTEESPCTFGEPKE 438 (577)
T ss_pred CCCccccc---------------Ccchhccceeccc-cceeeeeecccccceeeecCC-ceEEeeccCCcCccccCCccc
Confidence 22211110 0112455688997 699999999999999999999 7999998754311
Q ss_pred ------------------------------------eeeeec--------CCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 248 ------------------------------------TPIRRG--------FGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 248 ------------------------------------~~~~~~--------~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
..+... ...+..+.++|.+.+.+++..|+.|+++|.
T Consensus 439 ~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~~~~~hed~~Ir~~dn 518 (577)
T KOG0642|consen 439 HGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADITFTAHEDRSIRFFDN 518 (577)
T ss_pred cCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCeeEecccCCceecccc
Confidence 000000 013456778888889999999999999999
Q ss_pred CCCce-eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 284 NTWTS-EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 284 ~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.+++. .....|...++++++.|+|-+|+++.
T Consensus 519 ~~~~~l~s~~a~~~svtslai~~ng~~l~s~s 550 (577)
T KOG0642|consen 519 KTGKILHSMVAHKDSVTSLAIDPNGPYLMSGS 550 (577)
T ss_pred cccccchheeeccceecceeecCCCceEEeec
Confidence 99998 45668889999999999999999885
No 162
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.72 E-value=4.6e-17 Score=150.83 Aligned_cols=204 Identities=19% Similarity=0.270 Sum_probs=145.3
Q ss_pred ccCeeEEEEecCCCE----EEEEECCCeEEEEEccCC--CC-CceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEE
Q 018806 99 EVDLQGVSWHQHKHI----VAFISGSTQVIVRDYEDS--EG-KDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICI 170 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~----la~~s~d~~i~iw~~~~~--~~-~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~i 170 (350)
....+.++|.+.|.. ||.|..||.|.+|+.... .. .........|.+.|..+.|++....++++|. +|.|.|
T Consensus 64 ~~rF~kL~W~~~g~~~~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~q~nlLASGa~~geI~i 143 (1049)
T KOG0307|consen 64 SNRFNKLAWGSYGSHSHGLIAGGLEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPFQGNLLASGADDGEILI 143 (1049)
T ss_pred cccceeeeecccCCCccceeeccccCCceEEecchhhccCcchHHHhhhcccCCceeeeeccccCCceeeccCCCCcEEE
Confidence 456889999998865 888889999999998641 11 2222223469999999999999775555555 699999
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCe-EEEEEeCCCeEEEEeCCCCCcee
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRY-LASASYESSSFTIWDVAQGLGTP 249 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~-l~~~~~d~g~i~iwd~~~~~~~~ 249 (350)
||+.....+.... .....+.|.+++|+..-.+ |++++.+ |.+.|||++..+.+.
T Consensus 144 WDlnn~~tP~~~~------------------------~~~~~~eI~~lsWNrkvqhILAS~s~s-g~~~iWDlr~~~pii 198 (1049)
T KOG0307|consen 144 WDLNKPETPFTPG------------------------SQAPPSEIKCLSWNRKVSHILASGSPS-GRAVIWDLRKKKPII 198 (1049)
T ss_pred eccCCcCCCCCCC------------------------CCCCcccceEeccchhhhHHhhccCCC-CCceeccccCCCccc
Confidence 9998543322211 0001368999999986555 4555555 799999999875543
Q ss_pred -eeecC--CCeEEEEEcCCCC-EEEEEecCC---eEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 250 -IRRGF--GGLSILKWSPTGD-YFFAAKFDG---TFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 250 -~~~~~--~~v~~~~~sp~g~-~l~~~~~d~---~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
+..+. ..+..++|+|+.. .|++++.|. .|.+||++.... +.+..|...|.++.|++.+..++.++++++.+
T Consensus 199 ~ls~~~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~assP~k~~~~H~~GilslsWc~~D~~lllSsgkD~~i 278 (1049)
T KOG0307|consen 199 KLSDTPGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFASSPLKILEGHQRGILSLSWCPQDPRLLLSSGKDNRI 278 (1049)
T ss_pred ccccCCCccceeeeeeCCCCceeeeeecCCCCCceeEeecccccCCchhhhcccccceeeeccCCCCchhhhcccCCCCe
Confidence 33332 3477899999854 466665543 799999986554 45679999999999999886666666666677
Q ss_pred EEEEeCC
Q 018806 321 GSIHFAS 327 (350)
Q Consensus 321 ~~~~~~~ 327 (350)
..|....
T Consensus 279 i~wN~~t 285 (1049)
T KOG0307|consen 279 ICWNPNT 285 (1049)
T ss_pred eEecCCC
Confidence 7776554
No 163
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.72 E-value=7.8e-16 Score=119.60 Aligned_cols=217 Identities=12% Similarity=0.101 Sum_probs=145.2
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccC-------CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYED-------SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~-------~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
|.+-+|+|.+++|+.|+.+|.|.+..+.. ..++.......+|+++|+.++|.. . ++.++.||.|+-|...
T Consensus 13 vf~qa~sp~~~~l~agn~~G~iav~sl~sl~s~sa~~~gk~~iv~eqahdgpiy~~~f~d--~-~Lls~gdG~V~gw~W~ 89 (325)
T KOG0649|consen 13 VFAQAISPSKQYLFAGNLFGDIAVLSLKSLDSGSAEPPGKLKIVPEQAHDGPIYYLAFHD--D-FLLSGGDGLVYGWEWN 89 (325)
T ss_pred HHHHhhCCcceEEEEecCCCeEEEEEehhhhccccCCCCCcceeeccccCCCeeeeeeeh--h-heeeccCceEEEeeeh
Confidence 45567899999999999999999998753 223444444468999999999983 3 4455566999998876
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccC--CCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-ee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRS--QNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IR 251 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~ 251 (350)
.......... .|.+...... -.--.|.++...|....+++++.| +.++-||+++|+... +.
T Consensus 90 E~~es~~~K~---------------lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD-~~~y~~dlE~G~i~r~~r 153 (325)
T KOG0649|consen 90 EEEESLATKR---------------LWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGD-GVIYQVDLEDGRIQREYR 153 (325)
T ss_pred hhhhhccchh---------------hhhhcCccccCcccCCccceeEeccCCCcEEEecCC-eEEEEEEecCCEEEEEEc
Confidence 3322111000 1111111111 001368899999988888888888 699999999998765 66
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc----------cC-CCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS----------ST-SGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~----------~~-~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
+|...+.++.--.....+++|++||++++||.++++..... .| ..+|. +..-+..+|++|++....+
T Consensus 154 GHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k~v~~ie~yk~~~~lRp~~g~wig--ala~~edWlvCGgGp~lsl 231 (325)
T KOG0649|consen 154 GHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQKHVSMIEPYKNPNLLRPDWGKWIG--ALAVNEDWLVCGGGPKLSL 231 (325)
T ss_pred CCcceeeeeeecccCcceeecCCCccEEEEeccccceeEEeccccChhhcCcccCceeE--EEeccCceEEecCCCceeE
Confidence 78899999887444456889999999999999999874432 11 22344 4445677998776666565
Q ss_pred EEEEeCCCCC--CCceeeccc
Q 018806 321 GSIHFASKPP--SLDAHLLPV 339 (350)
Q Consensus 321 ~~~~~~~~~~--~~~~~~~~v 339 (350)
|.++-..... .+.+|..-+
T Consensus 232 whLrsse~t~vfpipa~v~~v 252 (325)
T KOG0649|consen 232 WHLRSSESTCVFPIPARVHLV 252 (325)
T ss_pred EeccCCCceEEEecccceeEe
Confidence 5554443322 344444433
No 164
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.72 E-value=1.1e-15 Score=121.68 Aligned_cols=153 Identities=16% Similarity=0.361 Sum_probs=109.0
Q ss_pred eEEEEecCCCEEEEEEC----------CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec--CCcEEE
Q 018806 103 QGVSWHQHKHIVAFISG----------STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC--KGGICI 170 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~----------d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~--d~~v~i 170 (350)
-.+.|+|+|++|+.-.. -+...||.++..+ .....+.....++|.+++|+|+|+.++++.. ++.+.+
T Consensus 9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~-~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~~~~v~l 87 (194)
T PF08662_consen 9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKN-IPVESIELKKEGPIHDVAWSPNGNEFAVIYGSMPAKVTL 87 (194)
T ss_pred EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCC-CccceeeccCCCceEEEEECcCCCEEEEEEccCCcccEE
Confidence 35789999988876432 2346677775433 2333443345567999999999998876643 589999
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC--CCeEEEEeCCCCCce
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYE--SSSFTIWDVAQGLGT 248 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~~~~~~ 248 (350)
||++ ... ...+. ...+..+.|+|+|++|++++.+ .|.|.+||+++.+..
T Consensus 88 yd~~-~~~-------------------------i~~~~---~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~~~i 138 (194)
T PF08662_consen 88 YDVK-GKK-------------------------IFSFG---TQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKKKKI 138 (194)
T ss_pred EcCc-ccE-------------------------eEeec---CCCceEEEECCCCCEEEEEEccCCCcEEEEEECCCCEEe
Confidence 9996 111 11121 2467889999999999998754 268999999977665
Q ss_pred eeeecCCCeEEEEEcCCCCEEEEEec------CCeEEEEeCCCC
Q 018806 249 PIRRGFGGLSILKWSPTGDYFFAAKF------DGTFYLWETNTW 286 (350)
Q Consensus 249 ~~~~~~~~v~~~~~sp~g~~l~~~~~------d~~v~iwd~~~~ 286 (350)
....+ ..+..++|+|||++|+++.. |+.++||+....
T Consensus 139 ~~~~~-~~~t~~~WsPdGr~~~ta~t~~r~~~dng~~Iw~~~G~ 181 (194)
T PF08662_consen 139 STFEH-SDATDVEWSPDGRYLATATTSPRLRVDNGFKIWSFQGR 181 (194)
T ss_pred ecccc-CcEEEEEEcCCCCEEEEEEeccceeccccEEEEEecCe
Confidence 54444 35789999999999988754 778999998644
No 165
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.72 E-value=7.6e-17 Score=131.82 Aligned_cols=144 Identities=13% Similarity=0.230 Sum_probs=113.3
Q ss_pred CCeeEEEEeeCCCeEEEEe-cCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC
Q 018806 145 RDVKVLEWRPNGGRSLSVG-CKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD 223 (350)
Q Consensus 145 ~~v~~~~~sp~~~~l~~~~-~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 223 (350)
..|.++.|+|....+++++ +|+.|.+||++.......+... -.-..++|+|.
T Consensus 188 Dti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~~---------------------------mRTN~IswnPe 240 (433)
T KOG0268|consen 188 DSISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVILT---------------------------MRTNTICWNPE 240 (433)
T ss_pred CceeEEecCCCcchheeeeccCCceEEEecccCCccceeeee---------------------------ccccceecCcc
Confidence 4578888888866666655 6899999999965544433221 35578999998
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCc--eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecc--ccCCCCeE
Q 018806 224 GRYLASASYESSSFTIWDVAQGLG--TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPW--SSTSGFVT 299 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~--~~~~~~v~ 299 (350)
+-.+++++.|. .++.||++.-.. .....|...|.++.|||.|+.+++|+.|.+|+||..+.+..... ..-...|.
T Consensus 241 afnF~~a~ED~-nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~~~~~~SRdiYhtkRMq~V~ 319 (433)
T KOG0268|consen 241 AFNFVAANEDH-NLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFPVNHGHSRDIYHTKRMQHVF 319 (433)
T ss_pred ccceeeccccc-cceehhhhhhcccchhhcccceeEEEeccCCCcchhccccccceEEEeecCCCcchhhhhHhhhheee
Confidence 88888899995 999999987543 23456778999999999999999999999999999998876432 23345799
Q ss_pred EEEEcCCCCEEEEEECC
Q 018806 300 GATWDPEGRMILLAFAG 316 (350)
Q Consensus 300 ~~~~s~~g~~l~~~~~~ 316 (350)
++.||.|.+++++|++.
T Consensus 320 ~Vk~S~Dskyi~SGSdd 336 (433)
T KOG0268|consen 320 CVKYSMDSKYIISGSDD 336 (433)
T ss_pred EEEEeccccEEEecCCC
Confidence 99999999999988633
No 166
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.70 E-value=4e-15 Score=126.80 Aligned_cols=194 Identities=11% Similarity=0.201 Sum_probs=146.5
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCc-------------------------------------eeEe
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKD-------------------------------------ACIL 139 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~-------------------------------------~~~~ 139 (350)
.+...|.++..-.+|.+| +|+.|+.|..||-+..+... ....
T Consensus 285 aH~ggv~~L~~lr~Gtll-SGgKDRki~~Wd~~y~k~r~~elPe~~G~iRtv~e~~~di~vGTtrN~iL~Gt~~~~f~~~ 363 (626)
T KOG2106|consen 285 AHDGGVFSLCMLRDGTLL-SGGKDRKIILWDDNYRKLRETELPEQFGPIRTVAEGKGDILVGTTRNFILQGTLENGFTLT 363 (626)
T ss_pred ecCCceEEEEEecCccEe-ecCccceEEeccccccccccccCchhcCCeeEEecCCCcEEEeeccceEEEeeecCCceEE
Confidence 334468888888898866 49999999999843111000 0011
Q ss_pred cCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEE
Q 018806 140 TSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALS 219 (350)
Q Consensus 140 ~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~ 219 (350)
..+|....+.++.+|+..++++++.|+.+++|+ . . ++. |..+. ..++.++.
T Consensus 364 v~gh~delwgla~hps~~q~~T~gqdk~v~lW~-~-~-k~~-----------------------wt~~~---~d~~~~~~ 414 (626)
T KOG2106|consen 364 VQGHGDELWGLATHPSKNQLLTCGQDKHVRLWN-D-H-KLE-----------------------WTKII---EDPAECAD 414 (626)
T ss_pred EEecccceeeEEcCCChhheeeccCcceEEEcc-C-C-cee-----------------------EEEEe---cCceeEee
Confidence 236777888999999988999999999999999 2 1 110 11111 25789999
Q ss_pred ECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee--c-cccCCC
Q 018806 220 WGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE--P-WSSTSG 296 (350)
Q Consensus 220 ~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~--~-~~~~~~ 296 (350)
|+|.| .++.++.. |...+.|..+.....+.....++.+++|+|+|.+||.|+.|+.|+||.+...... . -.-+..
T Consensus 415 fhpsg-~va~Gt~~-G~w~V~d~e~~~lv~~~~d~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs~~g~~y~r~~k~~gs 492 (626)
T KOG2106|consen 415 FHPSG-VVAVGTAT-GRWFVLDTETQDLVTIHTDNEQLSVVRYSPDGAFLAVGSHDNHIYIYRVSANGRKYSRVGKCSGS 492 (626)
T ss_pred ccCcc-eEEEeecc-ceEEEEecccceeEEEEecCCceEEEEEcCCCCEEEEecCCCeEEEEEECCCCcEEEEeeeecCc
Confidence 99999 99999888 7999999999777777766889999999999999999999999999998765542 1 123348
Q ss_pred CeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 297 FVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
+|+.+.||+|+++|.+- ...+.+-+|
T Consensus 493 ~ithLDwS~Ds~~~~~~----S~d~eiLyW 518 (626)
T KOG2106|consen 493 PITHLDWSSDSQFLVSN----SGDYEILYW 518 (626)
T ss_pred eeEEeeecCCCceEEec----cCceEEEEE
Confidence 99999999999999866 344566666
No 167
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=99.70 E-value=1.2e-15 Score=121.28 Aligned_cols=199 Identities=18% Similarity=0.326 Sum_probs=135.5
Q ss_pred CeeEEEEecC-CCEEEEEECC-------CeEEEEEccCCCCC-------ceeEecCCCCCCeeEEEEeeCCCeEEEEecC
Q 018806 101 DLQGVSWHQH-KHIVAFISGS-------TQVIVRDYEDSEGK-------DACILTSDSQRDVKVLEWRPNGGRSLSVGCK 165 (350)
Q Consensus 101 ~V~~v~~sp~-g~~la~~s~d-------~~i~iw~~~~~~~~-------~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d 165 (350)
+|+.++-+|- .+.|+++..+ ..+.||.+..+-+. .+..+...+-+.|.++.|.|++.++++. .|
T Consensus 65 Evw~las~P~d~~ilaT~yn~~s~s~vl~~aaiw~ipe~~~~S~~~tlE~v~~Ldteavg~i~cvew~Pns~klasm-~d 143 (370)
T KOG1007|consen 65 EVWDLASSPFDQRILATVYNDTSDSGVLTGAAIWQIPEPLGQSNSSTLECVASLDTEAVGKINCVEWEPNSDKLASM-DD 143 (370)
T ss_pred ceehhhcCCCCCceEEEEEeccCCCcceeeEEEEecccccCccccchhhHhhcCCHHHhCceeeEEEcCCCCeeEEe-cc
Confidence 4666666664 3555555431 24669998643222 2223322455689999999997666554 48
Q ss_pred CcEEEEecCCCCC-CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC--CCCeEEEEEeCCCeEEEEeC
Q 018806 166 GGICIWAPSYPGN-AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP--DGRYLASASYESSSFTIWDV 242 (350)
Q Consensus 166 ~~v~iwd~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp--~g~~l~~~~~d~g~i~iwd~ 242 (350)
..|.+|++..... ...+.... -.++. ...++-+|+| +|..+++.+ + +++..||+
T Consensus 144 n~i~l~~l~ess~~vaev~ss~--------------------s~e~~-~~ftsg~WspHHdgnqv~tt~-d-~tl~~~D~ 200 (370)
T KOG1007|consen 144 NNIVLWSLDESSKIVAEVLSSE--------------------SAEMR-HSFTSGAWSPHHDGNQVATTS-D-STLQFWDL 200 (370)
T ss_pred CceEEEEcccCcchheeecccc--------------------ccccc-ceecccccCCCCccceEEEeC-C-CcEEEEEc
Confidence 9999999986554 22222110 01112 3567789998 678887765 4 49999999
Q ss_pred CCCCceeee--ecCCCeEEEEEcCCCCE-EEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 243 AQGLGTPIR--RGFGGLSILKWSPTGDY-FFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 243 ~~~~~~~~~--~~~~~v~~~~~sp~g~~-l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
++..+.... .|...+..+.|+|+.++ |++++.||.|+|||.+..+. ..+.+|..+|+++.|+|.-..|+.+++.+
T Consensus 201 RT~~~~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hdqLiLs~~SD 280 (370)
T KOG1007|consen 201 RTMKKNNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHDQLILSGGSD 280 (370)
T ss_pred cchhhhcchhhhhcceeeeccCCCCceEEEEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccceEEEecCCC
Confidence 987665432 35567999999999775 68999999999999998765 56789999999999999876666655444
Q ss_pred eEEEEE
Q 018806 318 LTLGSI 323 (350)
Q Consensus 318 ~~~~~~ 323 (350)
..+..+
T Consensus 281 s~V~Ls 286 (370)
T KOG1007|consen 281 SAVNLS 286 (370)
T ss_pred ceeEEE
Confidence 444333
No 168
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.70 E-value=1.6e-15 Score=133.39 Aligned_cols=218 Identities=16% Similarity=0.303 Sum_probs=141.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC--
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN-- 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~-- 178 (350)
.|+.++|-|||..|+.+..+ .+.+||.+. |.....+ ++|...|.+++|+.||+++++++.|+.|.+|+-...+.
T Consensus 14 ci~d~afkPDGsqL~lAAg~-rlliyD~nd--G~llqtL-KgHKDtVycVAys~dGkrFASG~aDK~VI~W~~klEG~Lk 89 (1081)
T KOG1538|consen 14 CINDIAFKPDGTQLILAAGS-RLLVYDTSD--GTLLQPL-KGHKDTVYCVAYAKDGKRFASGSADKSVIIWTSKLEGILK 89 (1081)
T ss_pred chheeEECCCCceEEEecCC-EEEEEeCCC--ccccccc-ccccceEEEEEEccCCceeccCCCceeEEEecccccceee
Confidence 58999999999988876554 588999854 6655555 69999999999999999999999999999998774432
Q ss_pred ---Cceeecccccccce-ecCCCCCceEEeee-----ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee
Q 018806 179 ---AASVRSGAASFLGA-LSRGPGTRWTLVDF-----LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP 249 (350)
Q Consensus 179 ---~~~~~~~~~~~~~~-~~~~~~~~~~~~~~-----~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~ 249 (350)
...+....+.+... +..+.-..+.+|.. .+.....++.+.+|..||++++.|-.+ |+|.+-+-...+...
T Consensus 90 YSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~V~K~kss~R~~~CsWtnDGqylalG~~n-GTIsiRNk~gEek~~ 168 (1081)
T KOG1538|consen 90 YSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKSVSKHKSSSRIICCSWTNDGQYLALGMFN-GTISIRNKNGEEKVK 168 (1081)
T ss_pred eccCCeeeEeecCchHHHhhhcchhhccccChhhhhHHhhhhheeEEEeeecCCCcEEEEeccC-ceEEeecCCCCcceE
Confidence 22333334444332 22222222222221 111123578899999999999999988 799887654333333
Q ss_pred eee---cCCCeEEEEEcC----------------------------------------------CCCEEEEEecCCeEEE
Q 018806 250 IRR---GFGGLSILKWSP----------------------------------------------TGDYFFAAKFDGTFYL 280 (350)
Q Consensus 250 ~~~---~~~~v~~~~~sp----------------------------------------------~g~~l~~~~~d~~v~i 280 (350)
+.. .+.+|.+++|+| +|.++..|+.|+.+++
T Consensus 169 I~Rpgg~Nspiwsi~~~p~sg~G~~di~aV~DW~qTLSFy~LsG~~Igk~r~L~FdP~CisYf~NGEy~LiGGsdk~L~~ 248 (1081)
T KOG1538|consen 169 IERPGGSNSPIWSICWNPSSGEGRNDILAVADWGQTLSFYQLSGKQIGKDRALNFDPCCISYFTNGEYILLGGSDKQLSL 248 (1081)
T ss_pred EeCCCCCCCCceEEEecCCCCCCccceEEEEeccceeEEEEecceeecccccCCCCchhheeccCCcEEEEccCCCceEE
Confidence 322 234555555555 4444444444444444
Q ss_pred EeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 281 WETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 281 wd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
|--+.-..-++-....+|+.++..|++++++.|| ++.+.-+.+
T Consensus 249 fTR~GvrLGTvg~~D~WIWtV~~~PNsQ~v~~GCqDGTiACyNl 292 (1081)
T KOG1538|consen 249 FTRDGVRLGTVGEQDSWIWTVQAKPNSQYVVVGCQDGTIACYNL 292 (1081)
T ss_pred EeecCeEEeeccccceeEEEEEEccCCceEEEEEccCeeehhhh
Confidence 4322211222334567899999999999999998 665444433
No 169
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.70 E-value=1.9e-14 Score=125.57 Aligned_cols=204 Identities=12% Similarity=0.132 Sum_probs=133.5
Q ss_pred CeeEEEEecCCCEEEEEEC-CCeEEEEEccCCCCCc--eeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCC
Q 018806 101 DLQGVSWHQHKHIVAFISG-STQVIVRDYEDSEGKD--ACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~-d~~i~iw~~~~~~~~~--~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~ 176 (350)
....++|+|++++|++++. ++.+.+|+++.. +.. .... ..+......++++|+++.++++.. ++.|.+||+...
T Consensus 81 ~p~~i~~~~~g~~l~v~~~~~~~v~v~~~~~~-g~~~~~~~~-~~~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~ 158 (330)
T PRK11028 81 SPTHISTDHQGRFLFSASYNANCVSVSPLDKD-GIPVAPIQI-IEGLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDD 158 (330)
T ss_pred CceEEEECCCCCEEEEEEcCCCeEEEEEECCC-CCCCCceee-ccCCCcccEeEeCCCCCEEEEeeCCCCEEEEEEECCC
Confidence 4578999999999988764 889999999632 211 1111 123345678899999888877766 599999999743
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC--CCceeee---
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ--GLGTPIR--- 251 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~--~~~~~~~--- 251 (350)
+........ ............++|+|+|++++++...+++|.+|+++. ++...+.
T Consensus 159 g~l~~~~~~--------------------~~~~~~g~~p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~ 218 (330)
T PRK11028 159 GHLVAQEPA--------------------EVTTVEGAGPRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLD 218 (330)
T ss_pred CcccccCCC--------------------ceecCCCCCCceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEe
Confidence 322110000 000001235678999999999998887446999999974 3322111
Q ss_pred ec------CCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCCCc-eeccc---cCCCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 252 RG------FGGLSILKWSPTGDYFFAAKF-DGTFYLWETNTWT-SEPWS---STSGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 252 ~~------~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~~~-~~~~~---~~~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
.. ......+.|+|+|++++++.. ++.|.+|+++... ...+. ........++|+|||++|+++..++..+
T Consensus 219 ~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~~~~~~~~~~~~~~~~~p~~~~~~~dg~~l~va~~~~~~v 298 (330)
T PRK11028 219 MMPADFSDTRWAADIHITPDGRHLYACDRTASLISVFSVSEDGSVLSFEGHQPTETQPRGFNIDHSGKYLIAAGQKSHHI 298 (330)
T ss_pred cCCCcCCCCccceeEEECCCCCEEEEecCCCCeEEEEEEeCCCCeEEEeEEEeccccCCceEECCCCCEEEEEEccCCcE
Confidence 11 122346889999999988754 7899999986533 22222 1223456899999999999988545555
Q ss_pred EEEEeC
Q 018806 321 GSIHFA 326 (350)
Q Consensus 321 ~~~~~~ 326 (350)
..+++.
T Consensus 299 ~v~~~~ 304 (330)
T PRK11028 299 SVYEID 304 (330)
T ss_pred EEEEEc
Confidence 555543
No 170
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.69 E-value=3.4e-14 Score=124.01 Aligned_cols=201 Identities=10% Similarity=0.133 Sum_probs=133.3
Q ss_pred CeeEEEEecCCCEEEEEE-CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFIS-GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s-~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~ 178 (350)
....++++|++++|++++ .++.|.+|+++ .++...........+....++|+|+++.++++.. ++.|.+|++...+.
T Consensus 36 ~~~~l~~spd~~~lyv~~~~~~~i~~~~~~-~~g~l~~~~~~~~~~~p~~i~~~~~g~~l~v~~~~~~~v~v~~~~~~g~ 114 (330)
T PRK11028 36 QVQPMVISPDKRHLYVGVRPEFRVLSYRIA-DDGALTFAAESPLPGSPTHISTDHQGRFLFSASYNANCVSVSPLDKDGI 114 (330)
T ss_pred CCccEEECCCCCEEEEEECCCCcEEEEEEC-CCCceEEeeeecCCCCceEEEECCCCCEEEEEEcCCCeEEEEEECCCCC
Confidence 466789999999987765 47889999996 3333211111123345678999999888887776 69999999974332
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-cee-----ee-
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL-GTP-----IR- 251 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~-~~~-----~~- 251 (350)
.... ...+.+. .....++++|+|+++++++...+.|.+||+++.. ... ..
T Consensus 115 ~~~~---------------------~~~~~~~--~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~~~ 171 (330)
T PRK11028 115 PVAP---------------------IQIIEGL--EGCHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEVTT 171 (330)
T ss_pred CCCc---------------------eeeccCC--CcccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCceec
Confidence 2110 1111221 3467789999999998777665799999998632 211 11
Q ss_pred ecCCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCC--Ccee---cccc------CCCCeEEEEEcCCCCEEEEEECCCeE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKF-DGTFYLWETNT--WTSE---PWSS------TSGFVTGATWDPEGRMILLAFAGSLT 319 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~--~~~~---~~~~------~~~~v~~~~~s~~g~~l~~~~~~~~~ 319 (350)
........++|+|+|++++++.. +++|.+|+++. ++.. .+.. +......+.|+|+|++|+++......
T Consensus 172 ~~g~~p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~ 251 (330)
T PRK11028 172 VEGAGPRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASL 251 (330)
T ss_pred CCCCCCceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCe
Confidence 12345678999999999988776 89999999973 3331 1111 11223468899999999998654445
Q ss_pred EEEEEe
Q 018806 320 LGSIHF 325 (350)
Q Consensus 320 ~~~~~~ 325 (350)
+..|++
T Consensus 252 I~v~~i 257 (330)
T PRK11028 252 ISVFSV 257 (330)
T ss_pred EEEEEE
Confidence 555554
No 171
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.69 E-value=1.3e-14 Score=127.69 Aligned_cols=193 Identities=16% Similarity=0.137 Sum_probs=145.1
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|.+++|++ +..|.+.+.+|.|.-||+.+ .+....+ ....+.|++++.+|.+..++.++.||.+..++...+
T Consensus 71 sIE~L~W~e-~~RLFS~g~sg~i~EwDl~~--lk~~~~~-d~~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~---- 142 (691)
T KOG2048|consen 71 SIESLAWAE-GGRLFSSGLSGSITEWDLHT--LKQKYNI-DSNGGAIWSIAINPENTILAIGCDDGVLYDFSIGPD---- 142 (691)
T ss_pred ceeeEEEcc-CCeEEeecCCceEEEEeccc--CceeEEe-cCCCcceeEEEeCCccceEEeecCCceEEEEecCCc----
Confidence 589999994 55677889999999999954 6655555 357789999999999666666666796666665521
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-----ec--
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-----RG-- 253 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-----~~-- 253 (350)
.+.....+... .+++.+++|+|++..|+.|+.| |.|++||..++....+. .-
T Consensus 143 -------------------~I~~~r~l~rq-~sRvLslsw~~~~~~i~~Gs~D-g~Iriwd~~~~~t~~~~~~~~d~l~k 201 (691)
T KOG2048|consen 143 -------------------KITYKRSLMRQ-KSRVLSLSWNPTGTKIAGGSID-GVIRIWDVKSGQTLHIITMQLDRLSK 201 (691)
T ss_pred -------------------eEEEEeecccc-cceEEEEEecCCccEEEecccC-ceEEEEEcCCCceEEEeeeccccccc
Confidence 11122233333 3799999999999999999999 79999999998765422 11
Q ss_pred --CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 254 --FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 254 --~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
..-|+++.|-.++ .|++|...|+|.+||...++.. .+..|..-|.+++-++++.++++++ ++. +..+..
T Consensus 202 ~~~~iVWSv~~Lrd~-tI~sgDS~G~V~FWd~~~gTLiqS~~~h~adVl~Lav~~~~d~vfsaGvd~~--ii~~~~ 274 (691)
T KOG2048|consen 202 REPTIVWSVLFLRDS-TIASGDSAGTVTFWDSIFGTLIQSHSCHDADVLALAVADNEDRVFSAGVDPK--IIQYSL 274 (691)
T ss_pred CCceEEEEEEEeecC-cEEEecCCceEEEEcccCcchhhhhhhhhcceeEEEEcCCCCeEEEccCCCc--eEEEEe
Confidence 1236777777665 6889999999999999999984 5668899999999999999998876 443 444444
No 172
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.69 E-value=1.7e-14 Score=129.83 Aligned_cols=217 Identities=15% Similarity=0.210 Sum_probs=155.8
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCC-CCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDS-QRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~-~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~ 178 (350)
.|+++.=+|--..+|.|..+|+|.|+++.. ++.+..+ .| .+.|++++|.-||..+++++.. |.+.+||++....
T Consensus 204 ~IT~ieqsPaLDVVaiG~~~G~ViifNlK~--dkil~sF--k~d~g~VtslSFrtDG~p~las~~~~G~m~~wDLe~kkl 279 (910)
T KOG1539|consen 204 RITAIEQSPALDVVAIGLENGTVIIFNLKF--DKILMSF--KQDWGRVTSLSFRTDGNPLLASGRSNGDMAFWDLEKKKL 279 (910)
T ss_pred ceeEeccCCcceEEEEeccCceEEEEEccc--CcEEEEE--EccccceeEEEeccCCCeeEEeccCCceEEEEEcCCCee
Confidence 689999999889999999999999999953 5555555 35 4899999999999988888885 9999999985444
Q ss_pred Cceeecccccccce----------ecCCCC-----------------------------------------------Cce
Q 018806 179 AASVRSGAASFLGA----------LSRGPG-----------------------------------------------TRW 201 (350)
Q Consensus 179 ~~~~~~~~~~~~~~----------~~~~~~-----------------------------------------------~~~ 201 (350)
...+...+...+.. +..+.| ..+
T Consensus 280 ~~v~~nah~~sv~~~~fl~~epVl~ta~~DnSlk~~vfD~~dg~pR~LR~R~GHs~Pp~~irfy~~~g~~ilsa~~Drt~ 359 (910)
T KOG1539|consen 280 INVTRNAHYGSVTGATFLPGEPVLVTAGADNSLKVWVFDSGDGVPRLLRSRGGHSAPPSCIRFYGSQGHFILSAKQDRTL 359 (910)
T ss_pred eeeeeccccCCcccceecCCCceEeeccCCCceeEEEeeCCCCcchheeeccCCCCCchheeeeccCcEEEEecccCcch
Confidence 33333222111110 000000 000
Q ss_pred E-----------------------------------------------------------------Eee---------ec
Q 018806 202 T-----------------------------------------------------------------LVD---------FL 207 (350)
Q Consensus 202 ~-----------------------------------------------------------------~~~---------~~ 207 (350)
+ .|+ .+
T Consensus 360 r~fs~~~e~~~~~l~~~~~~~~~kk~~~~~~~~~k~p~i~~fa~~~~RE~~W~Nv~~~h~~~~~~~tW~~~n~~~G~~~L 439 (910)
T KOG1539|consen 360 RSFSVISESQSQELGQLHNKKRAKKVNVFSTEKLKLPPIVEFAFENAREKEWDNVITAHKGKRSAYTWNFRNKTSGRHVL 439 (910)
T ss_pred hhhhhhHHHHhHhhcccccccccccccccchhhhcCCcceeeecccchhhhhcceeEEecCcceEEEEeccCcccccEEe
Confidence 0 000 01
Q ss_pred cCC----CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee----ecCCCeEEEEEcCCCCEEEEEecCCeEE
Q 018806 208 RSQ----NGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR----RGFGGLSILKWSPTGDYFFAAKFDGTFY 279 (350)
Q Consensus 208 ~~~----~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~----~~~~~v~~~~~sp~g~~l~~~~~d~~v~ 279 (350)
... -+..+++++.++-|++.+.|... |+|-+|++++|-....+ .|.++|..++..--++.+++++.+|.++
T Consensus 440 ~~~~~~~~~~~~~av~vs~CGNF~~IG~S~-G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gilk 518 (910)
T KOG1539|consen 440 DPKRFKKDDINATAVCVSFCGNFVFIGYSK-GTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGILK 518 (910)
T ss_pred cCccccccCcceEEEEEeccCceEEEeccC-CeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcceEE
Confidence 100 12467788889999988888877 79999999999766544 5789999999998899999999999999
Q ss_pred EEeCCCCce------------------------------------------eccccCCCCeEEEEEcCCCCEEEEEE-CC
Q 018806 280 LWETNTWTS------------------------------------------EPWSSTSGFVTGATWDPEGRMILLAF-AG 316 (350)
Q Consensus 280 iwd~~~~~~------------------------------------------~~~~~~~~~v~~~~~s~~g~~l~~~~-~~ 316 (350)
+||...... +.+.+|.+.|++++|||||++|++++ |+
T Consensus 519 fw~f~~k~l~~~l~l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~DgrWlisasmD~ 598 (910)
T KOG1539|consen 519 FWDFKKKVLKKSLRLGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSPDGRWLISASMDS 598 (910)
T ss_pred EEecCCcceeeeeccCCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhhccccceeeeEeCCCCcEEEEeecCC
Confidence 999876441 11236899999999999999999987 44
Q ss_pred CeEEEE
Q 018806 317 SLTLGS 322 (350)
Q Consensus 317 ~~~~~~ 322 (350)
.+++|+
T Consensus 599 tIr~wD 604 (910)
T KOG1539|consen 599 TIRTWD 604 (910)
T ss_pred cEEEEe
Confidence 444333
No 173
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.69 E-value=4.6e-15 Score=119.88 Aligned_cols=202 Identities=15% Similarity=0.185 Sum_probs=144.1
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCC----------ceeEecCCCCCCeeEEEEe-------eCCCeEEEEec
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGK----------DACILTSDSQRDVKVLEWR-------PNGGRSLSVGC 164 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~----------~~~~~~~~~~~~v~~~~~s-------p~~~~l~~~~~ 164 (350)
...+.|||||..|++-+.|..+++|++...... ....+.......|...+|- |+...+++++.
T Consensus 52 ~kgckWSPDGSciL~~sedn~l~~~nlP~dlys~~~~~~~~~~~~~~~r~~eg~tvydy~wYs~M~s~qP~t~l~a~ssr 131 (406)
T KOG2919|consen 52 LKGCKWSPDGSCILSLSEDNCLNCWNLPFDLYSKKADGPLNFSKHLSYRYQEGETVYDYCWYSRMKSDQPSTNLFAVSSR 131 (406)
T ss_pred hccceeCCCCceEEeecccCeeeEEecChhhcccCCCCccccccceeEEeccCCEEEEEEeeeccccCCCccceeeeccc
Confidence 567899999999999999999999998531110 1111212345678888885 66555666666
Q ss_pred CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeC-C
Q 018806 165 KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDV-A 243 (350)
Q Consensus 165 d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~-~ 243 (350)
+.-|++||.-+++....... .+....- ....+++|+|||.+|+++-.. +|++||+ +
T Consensus 132 ~~PIh~wdaftG~lraSy~~-------------------ydh~de~--taAhsL~Fs~DGeqlfaGykr--cirvFdt~R 188 (406)
T KOG2919|consen 132 DQPIHLWDAFTGKLRASYRA-------------------YDHQDEY--TAAHSLQFSPDGEQLFAGYKR--CIRVFDTSR 188 (406)
T ss_pred cCceeeeeccccccccchhh-------------------hhhHHhh--hhheeEEecCCCCeEeecccc--eEEEeeccC
Confidence 89999999985554332211 1111111 245689999999999987554 8999999 5
Q ss_pred CCCcee---eeec-----CCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEE
Q 018806 244 QGLGTP---IRRG-----FGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 244 ~~~~~~---~~~~-----~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
.|.... ...+ .+-+.+++|+|- .+.+++++....+-||+-..+... .+.+|.+.|+.+.|.++|+.|++|
T Consensus 189 pGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~~giy~~~~~~pl~llggh~gGvThL~~~edGn~lfsG 268 (406)
T KOG2919|consen 189 PGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSG 268 (406)
T ss_pred CCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccceeeeEecCCCCceeeecccCCCeeeEEeccCcCeeccc
Confidence 554221 1112 456889999995 558899999999999988877764 455899999999999999999999
Q ss_pred ECCCeEEEEEEeC
Q 018806 314 FAGSLTLGSIHFA 326 (350)
Q Consensus 314 ~~~~~~~~~~~~~ 326 (350)
..++-.|-.|++.
T Consensus 269 aRk~dkIl~WDiR 281 (406)
T KOG2919|consen 269 ARKDDKILCWDIR 281 (406)
T ss_pred ccCCCeEEEEeeh
Confidence 8666666666664
No 174
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.68 E-value=7.6e-15 Score=117.81 Aligned_cols=189 Identities=17% Similarity=0.304 Sum_probs=143.7
Q ss_pred ecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeE
Q 018806 139 LTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITAL 218 (350)
Q Consensus 139 ~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 218 (350)
+..+|..-|.++.|.+.|+++++++.|.+|+|||.... .+.|.+....+.|. +.|..+
T Consensus 8 i~s~h~DlihdVs~D~~GRRmAtCSsDq~vkI~d~~~~---------------------s~~W~~Ts~Wrah~-~Si~rV 65 (361)
T KOG2445|consen 8 IDSGHKDLIHDVSFDFYGRRMATCSSDQTVKIWDSTSD---------------------SGTWSCTSSWRAHD-GSIWRV 65 (361)
T ss_pred cccCCcceeeeeeecccCceeeeccCCCcEEEEeccCC---------------------CCceEEeeeEEecC-CcEEEE
Confidence 33478899999999999999999999999999997622 34677777788886 899999
Q ss_pred EECC--CCCeEEEEEeCCCeEEEEeCCCC-------C---ceeeeecCCCeEEEEEcCC--CCEEEEEecCCeEEEEeCC
Q 018806 219 SWGP--DGRYLASASYESSSFTIWDVAQG-------L---GTPIRRGFGGLSILKWSPT--GDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 219 ~~sp--~g~~l~~~~~d~g~i~iwd~~~~-------~---~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~~v~iwd~~ 284 (350)
.|.+ -|+.+|+++.| +++.||.-... + +..+......|+.++|.|. |-.+|+++.||.++||+..
T Consensus 66 ~WAhPEfGqvvA~cS~D-rtv~iWEE~~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~ 144 (361)
T KOG2445|consen 66 VWAHPEFGQVVATCSYD-RTVSIWEEQEKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAP 144 (361)
T ss_pred EecCccccceEEEEecC-CceeeeeecccccccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecC
Confidence 9965 49999999999 59999975311 1 1223345678999999995 7788999999999999875
Q ss_pred CCce-ec------cc-------cCCCCeEEEEEcCC---CCEEEEEECC------CeEEEEEEeCC----CCCCCceeec
Q 018806 285 TWTS-EP------WS-------STSGFVTGATWDPE---GRMILLAFAG------SLTLGSIHFAS----KPPSLDAHLL 337 (350)
Q Consensus 285 ~~~~-~~------~~-------~~~~~v~~~~~s~~---g~~l~~~~~~------~~~~~~~~~~~----~~~~~~~~~~ 337 (350)
..-. .+ +. .+..+..++.|+|. ..+|++|++. ...||...-.. +..++..|..
T Consensus 145 dp~nLs~W~Lq~Ei~~~~~pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~d 224 (361)
T KOG2445|consen 145 DPMNLSQWTLQHEIQNVIDPPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTD 224 (361)
T ss_pred CccccccchhhhhhhhccCCcccccCcceEEeeccccccCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCC
Confidence 4221 11 11 35667889999984 4779999866 45555544333 3347889999
Q ss_pred ccccceeecccCC
Q 018806 338 PVDLPDIVSLTGR 350 (350)
Q Consensus 338 ~v~~~~~~~~~g~ 350 (350)
||+...+.+.-||
T Consensus 225 pI~di~wAPn~Gr 237 (361)
T KOG2445|consen 225 PIRDISWAPNIGR 237 (361)
T ss_pred cceeeeeccccCC
Confidence 9999999888776
No 175
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.68 E-value=5.4e-15 Score=117.81 Aligned_cols=197 Identities=16% Similarity=0.291 Sum_probs=147.1
Q ss_pred CeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-eEEEEecCCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~~~~ 178 (350)
++++..|+. +-++|.+.|-|.+..|||++......+.+....|+..|..++|...+. .++++|.||.|++||++...+
T Consensus 152 PlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leH 231 (364)
T KOG0290|consen 152 PLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEH 231 (364)
T ss_pred cccccccccCCcceeEeecccCeEEEEEEeeccccceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEeccccc
Confidence 688999986 568999999999999999976412122333358999999999998654 455677799999999996555
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc--eeeeecCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLG--TPIRRGFG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~~ 255 (350)
...+.... .. ..+...++|++. -+++|+-..|+..|.|.|++.... ..+..|.+
T Consensus 232 STIIYE~p---------------------~~--~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a 288 (364)
T KOG0290|consen 232 STIIYEDP---------------------SP--STPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQA 288 (364)
T ss_pred ceEEecCC---------------------CC--CCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcc
Confidence 44433221 10 247788999874 567787777767999999997643 45778999
Q ss_pred CeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCcee------ccccCCCCeEEEEEcC-CCCEEEEEECCCeEE
Q 018806 256 GLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTSE------PWSSTSGFVTGATWDP-EGRMILLAFAGSLTL 320 (350)
Q Consensus 256 ~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~~------~~~~~~~~v~~~~~s~-~g~~l~~~~~~~~~~ 320 (350)
.|..++|.|. ...|++++.|..+-+||+...-.. -....++.|..+.|++ .+.+++.+.++...+
T Consensus 289 ~VNgIaWaPhS~~hictaGDD~qaliWDl~q~~~~~~~dPilay~a~~EVNqi~Ws~~~~Dwiai~~~kklei 361 (364)
T KOG0290|consen 289 SVNGIAWAPHSSSHICTAGDDCQALIWDLQQMPRENGEDPILAYTAGGEVNQIQWSSSQPDWIAICFGKKLEI 361 (364)
T ss_pred cccceEecCCCCceeeecCCcceEEEEecccccccCCCCchhhhhccceeeeeeecccCCCEEEEEecCeeeE
Confidence 9999999996 567999999999999999764331 1123577899999995 678888887665443
No 176
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.68 E-value=4.3e-14 Score=127.83 Aligned_cols=216 Identities=16% Similarity=0.189 Sum_probs=142.7
Q ss_pred ccCeeEEEEecCCCEEEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CC--cEEEEe
Q 018806 99 EVDLQGVSWHQHKHIVAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KG--GICIWA 172 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~--~v~iwd 172 (350)
+..+...+|||||++|++.+.+ ..|.+|++.. +.. ..+. ...+.+...+|+|||+++++... ++ .|++||
T Consensus 198 ~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~--g~~-~~l~-~~~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d 273 (430)
T PRK00178 198 REPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDT--GRR-EQIT-NFEGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMD 273 (430)
T ss_pred CCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCC--CCE-EEcc-CCCCCcCCeEECCCCCEEEEEEccCCCceEEEEE
Confidence 3468899999999999987644 3577888854 332 2222 23345667999999988876554 44 577778
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceee
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPI 250 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~ 250 (350)
+..+. ... +..+. .......|+|||+.|+..+..+| .|+++|+.+++...+
T Consensus 274 ~~~~~-~~~-------------------------lt~~~-~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g~~~~l 326 (430)
T PRK00178 274 LASRQ-LSR-------------------------VTNHP-AIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGGRAERV 326 (430)
T ss_pred CCCCC-eEE-------------------------cccCC-CCcCCeEECCCCCEEEEEECCCCCceEEEEECCCCCEEEe
Confidence 76322 111 22222 34567899999999988775433 688888888876554
Q ss_pred eecCCCeEEEEEcCCCCEEEEEecC-C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEe
Q 018806 251 RRGFGGLSILKWSPTGDYFFAAKFD-G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHF 325 (350)
Q Consensus 251 ~~~~~~v~~~~~sp~g~~l~~~~~d-~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~ 325 (350)
...........|+|||++|+..+.+ + .|++||+.+++...+... .......|+|||++|+++. ++...++.++.
T Consensus 327 t~~~~~~~~~~~Spdg~~i~~~~~~~~~~~l~~~dl~tg~~~~lt~~-~~~~~p~~spdg~~i~~~~~~~g~~~l~~~~~ 405 (430)
T PRK00178 327 TFVGNYNARPRLSADGKTLVMVHRQDGNFHVAAQDLQRGSVRILTDT-SLDESPSVAPNGTMLIYATRQQGRGVLMLVSI 405 (430)
T ss_pred ecCCCCccceEECCCCCEEEEEEccCCceEEEEEECCCCCEEEccCC-CCCCCceECCCCCEEEEEEecCCceEEEEEEC
Confidence 4333344567899999999876643 3 588999998877555432 2334678999999999887 33456888887
Q ss_pred CCCCC-CCceeecccccceeec
Q 018806 326 ASKPP-SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 326 ~~~~~-~~~~~~~~v~~~~~~~ 346 (350)
..... .+..+...+..|.+.+
T Consensus 406 ~g~~~~~l~~~~g~~~~p~ws~ 427 (430)
T PRK00178 406 NGRVRLPLPTAQGEVREPSWSP 427 (430)
T ss_pred CCCceEECcCCCCCcCCCccCC
Confidence 65543 3433334455555554
No 177
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.68 E-value=3.4e-15 Score=120.62 Aligned_cols=189 Identities=15% Similarity=0.259 Sum_probs=135.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecC-----CCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTS-----DSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~-----~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~ 174 (350)
...+++|+|||.+|.+ +....|+++|.......+....+. +..+-|.+++|+|-....+++++ ...+-||.-.
T Consensus 160 aAhsL~Fs~DGeqlfa-GykrcirvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~~giy~~~ 238 (406)
T KOG2919|consen 160 AAHSLQFSPDGEQLFA-GYKRCIRVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDD 238 (406)
T ss_pred hheeEEecCCCCeEee-cccceEEEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccceeeeEecC
Confidence 4689999999999975 567789999985332222222211 23678899999998775666655 5777777655
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--eeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--PIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~~~~ 252 (350)
. +.+ ...+-+|. +.|+.+.|.++|+.|++++..+-.|..||++.-... .+..
T Consensus 239 ~-~~p------------------------l~llggh~-gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~~pv~~L~r 292 (406)
T KOG2919|consen 239 G-RRP------------------------LQLLGGHG-GGVTHLQWCEDGNKLFSGARKDDKILCWDIRYSRDPVYALER 292 (406)
T ss_pred C-CCc------------------------eeeecccC-CCeeeEEeccCcCeecccccCCCeEEEEeehhccchhhhhhh
Confidence 2 222 33345665 799999999999999999875559999999865432 2333
Q ss_pred cCC-CeEE--EEEcCCCCEEEEEecCCeEEEEeCCC-Cc-eeccccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 253 GFG-GLSI--LKWSPTGDYFFAAKFDGTFYLWETNT-WT-SEPWSSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 253 ~~~-~v~~--~~~sp~g~~l~~~~~d~~v~iwd~~~-~~-~~~~~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
|.+ .-.. ....|+|++|++|+.||.|++||+++ +. ...+..+...+..++++|-=.+++++++.
T Consensus 293 hv~~TNQRI~FDld~~~~~LasG~tdG~V~vwdlk~~gn~~sv~~~~sd~vNgvslnP~mpilatssGq 361 (406)
T KOG2919|consen 293 HVGDTNQRILFDLDPKGEILASGDTDGSVRVWDLKDLGNEVSVTGNYSDTVNGVSLNPIMPILATSSGQ 361 (406)
T ss_pred hccCccceEEEecCCCCceeeccCCCccEEEEecCCCCCcccccccccccccceecCcccceeeeccCc
Confidence 333 2223 44568999999999999999999998 55 34566788889999999987777766543
No 178
>PRK05137 tolB translocation protein TolB; Provisional
Probab=99.67 E-value=2.7e-14 Score=128.97 Aligned_cols=175 Identities=17% Similarity=0.245 Sum_probs=125.5
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec---CCcEEEEecCCCCCCceeecccccccceecCCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC---KGGICIWAPSYPGNAASVRSGAASFLGALSRGPG 198 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~---d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~ 198 (350)
.|.++|.+ +.....+. .+...+.+++|+|||+.+++++. +..|++||+..+.. ..
T Consensus 183 ~l~~~d~d---g~~~~~lt-~~~~~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~-~~----------------- 240 (435)
T PRK05137 183 RLAIMDQD---GANVRYLT-DGSSLVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQR-EL----------------- 240 (435)
T ss_pred EEEEECCC---CCCcEEEe-cCCCCeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcE-EE-----------------
Confidence 56677764 44444443 56778999999999998888765 36799999873321 11
Q ss_pred CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec-C
Q 018806 199 TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF-D 275 (350)
Q Consensus 199 ~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d 275 (350)
+..+ .+.+...+|+|||+.|+.....+| .|++||+.++....+..+.......+|+|||+.|+..+. +
T Consensus 241 --------l~~~-~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~~~~Lt~~~~~~~~~~~spDG~~i~f~s~~~ 311 (435)
T PRK05137 241 --------VGNF-PGMTFAPRFSPDGRKVVMSLSQGGNTDIYTMDLRSGTTTRLTDSPAIDTSPSYSPDGSQIVFESDRS 311 (435)
T ss_pred --------eecC-CCcccCcEECCCCCEEEEEEecCCCceEEEEECCCCceEEccCCCCccCceeEcCCCCEEEEEECCC
Confidence 1222 246678899999998876543223 588889998877766666666778999999999987764 3
Q ss_pred C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCC
Q 018806 276 G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFAS 327 (350)
Q Consensus 276 ~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~ 327 (350)
+ .|+++|+.+++...+......+..+.|+|||++|++... +...++.++...
T Consensus 312 g~~~Iy~~d~~g~~~~~lt~~~~~~~~~~~SpdG~~ia~~~~~~~~~~i~~~d~~~ 367 (435)
T PRK05137 312 GSPQLYVMNADGSNPRRISFGGGRYSTPVWSPRGDLIAFTKQGGGQFSIGVMKPDG 367 (435)
T ss_pred CCCeEEEEECCCCCeEEeecCCCcccCeEECCCCCEEEEEEcCCCceEEEEEECCC
Confidence 3 689999988877766655566778899999999998763 235677777643
No 179
>PRK01029 tolB translocation protein TolB; Provisional
Probab=99.67 E-value=3.3e-14 Score=127.38 Aligned_cols=217 Identities=12% Similarity=0.142 Sum_probs=134.3
Q ss_pred CeeEEEEecCCCEE--EEEE-CCC--eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-C--cEE--E
Q 018806 101 DLQGVSWHQHKHIV--AFIS-GST--QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-G--GIC--I 170 (350)
Q Consensus 101 ~V~~v~~sp~g~~l--a~~s-~d~--~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~--~v~--i 170 (350)
...+-.|||||+.+ +..+ .++ .|.+.+++. +.... +. ...+.....+|+|||++|++.+.. + .++ +
T Consensus 186 ~~~sP~wSPDG~~~~~~y~S~~~g~~~I~~~~l~~--g~~~~-lt-~~~g~~~~p~wSPDG~~Laf~s~~~g~~di~~~~ 261 (428)
T PRK01029 186 LSITPTWMHIGSGFPYLYVSYKLGVPKIFLGSLEN--PAGKK-IL-ALQGNQLMPTFSPRKKLLAFISDRYGNPDLFIQS 261 (428)
T ss_pred CcccceEccCCCceEEEEEEccCCCceEEEEECCC--CCceE-ee-cCCCCccceEECCCCCEEEEEECCCCCcceeEEE
Confidence 45678999999753 2233 344 455556643 43322 22 234456678999999998887652 3 333 3
Q ss_pred EecCCC--CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCe--EEEEeCCC--
Q 018806 171 WAPSYP--GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSS--FTIWDVAQ-- 244 (350)
Q Consensus 171 wd~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~--i~iwd~~~-- 244 (350)
|++... +....+ .... .......+|+|||+.|++.+..+|. |+++++..
T Consensus 262 ~~~~~g~~g~~~~l------------------------t~~~-~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~~~g 316 (428)
T PRK01029 262 FSLETGAIGKPRRL------------------------LNEA-FGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQIDPEG 316 (428)
T ss_pred eecccCCCCcceEe------------------------ecCC-CCCcCCeEECCCCCEEEEEECCCCCceEEEEECcccc
Confidence 555421 111111 1111 1234678999999999887754354 44445542
Q ss_pred CCceeeeecCCCeEEEEEcCCCCEEEEEecC---CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE--CCCeE
Q 018806 245 GLGTPIRRGFGGLSILKWSPTGDYFFAAKFD---GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF--AGSLT 319 (350)
Q Consensus 245 ~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~ 319 (350)
+....+......+....|+|||++|+..+.+ ..|++||+.+++...+......+..+.|+|||++|++.. .+...
T Consensus 317 ~~~~~lt~~~~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g~~~~Lt~~~~~~~~p~wSpDG~~L~f~~~~~g~~~ 396 (428)
T PRK01029 317 QSPRLLTKKYRNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATGRDYQLTTSPENKESPSWAIDSLHLVYSAGNSNESE 396 (428)
T ss_pred cceEEeccCCCCccceeECCCCCEEEEEEcCCCCcEEEEEECCCCCeEEccCCCCCccceEECCCCCEEEEEECCCCCce
Confidence 2233344444567789999999999876543 379999999998877665555678899999999998765 34467
Q ss_pred EEEEEeCCCCC-CCceeecccccceeec
Q 018806 320 LGSIHFASKPP-SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 320 ~~~~~~~~~~~-~~~~~~~~v~~~~~~~ 346 (350)
++.+++..... .+......+..|.+.+
T Consensus 397 L~~vdl~~g~~~~Lt~~~g~~~~p~Ws~ 424 (428)
T PRK01029 397 LYLISLITKKTRKIVIGSGEKRFPSWGA 424 (428)
T ss_pred EEEEECCCCCEEEeecCCCcccCceecC
Confidence 88888765543 2322333345555544
No 180
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.67 E-value=4e-14 Score=127.74 Aligned_cols=214 Identities=17% Similarity=0.173 Sum_probs=136.0
Q ss_pred CeeEEEEecCCCEEEEEECC-C--eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCc--EEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISGS-T--QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGG--ICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d-~--~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~--v~iwd~~ 174 (350)
.+.+..|||||++|+..+.+ + .|.+||+.. ++. ..+. ...+.....+|+|||+.++++.. ++. |+++|+.
T Consensus 219 ~~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~t--g~~-~~lt-~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~ 294 (448)
T PRK04792 219 PLMSPAWSPDGRKLAYVSFENRKAEIFVQDIYT--QVR-EKVT-SFPGINGAPRFSPDGKKLALVLSKDGQPEIYVVDIA 294 (448)
T ss_pred cccCceECCCCCEEEEEEecCCCcEEEEEECCC--CCe-EEec-CCCCCcCCeeECCCCCEEEEEEeCCCCeEEEEEECC
Confidence 57789999999999987643 3 466777643 432 2222 22334567899999998887654 454 6666665
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~ 252 (350)
.+ ... .+..+. ......+|+|||+.|+..+..+| .|+++|+.+++...+..
T Consensus 295 tg-~~~-------------------------~lt~~~-~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~~Lt~ 347 (448)
T PRK04792 295 TK-ALT-------------------------RITRHR-AIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVSRLTF 347 (448)
T ss_pred CC-CeE-------------------------ECccCC-CCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEEec
Confidence 22 111 122222 35567899999999988765433 57777888777655543
Q ss_pred cCCCeEEEEEcCCCCEEEEEec-CC--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKF-DG--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFAS 327 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~-d~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~ 327 (350)
........+|+|||++|+..+. ++ .|.++|+.+++...+... .......|+|||++|+++.. +...++.++...
T Consensus 348 ~g~~~~~~~~SpDG~~l~~~~~~~g~~~I~~~dl~~g~~~~lt~~-~~d~~ps~spdG~~I~~~~~~~g~~~l~~~~~~G 426 (448)
T PRK04792 348 EGEQNLGGSITPDGRSMIMVNRTNGKFNIARQDLETGAMQVLTST-RLDESPSVAPNGTMVIYSTTYQGKQVLAAVSIDG 426 (448)
T ss_pred CCCCCcCeeECCCCCEEEEEEecCCceEEEEEECCCCCeEEccCC-CCCCCceECCCCCEEEEEEecCCceEEEEEECCC
Confidence 3333456799999999977654 33 567788888876554432 22345689999999988763 334577777655
Q ss_pred CCC-CCceeecccccceeec
Q 018806 328 KPP-SLDAHLLPVDLPDIVS 346 (350)
Q Consensus 328 ~~~-~~~~~~~~v~~~~~~~ 346 (350)
... .+..+...+..|.+.+
T Consensus 427 ~~~~~l~~~~g~~~~p~Wsp 446 (448)
T PRK04792 427 RFKARLPAGQGEVKSPAWSP 446 (448)
T ss_pred CceEECcCCCCCcCCCccCC
Confidence 432 3433344455555554
No 181
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.66 E-value=3.3e-15 Score=128.27 Aligned_cols=189 Identities=20% Similarity=0.316 Sum_probs=128.3
Q ss_pred cCCCEEEEEECCCeEEEEEccCCCCCceeEecC----CCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCce--
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDSEGKDACILTS----DSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAAS-- 181 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~----~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~-- 181 (350)
|.+--|..|-.-|.+.+.|.-. .....++. -.+..|++++|-|.+..++.++. +|.+++||.........
T Consensus 183 ~~g~dllIGf~tGqvq~idp~~---~~~sklfne~r~i~ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~ 259 (636)
T KOG2394|consen 183 PKGLDLLIGFTTGQVQLIDPIN---FEVSKLFNEERLINKSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPS 259 (636)
T ss_pred CCCcceEEeeccCceEEecchh---hHHHHhhhhcccccccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCc
Confidence 4565667777788888887642 11111111 13468999999998776666665 79999998752211110
Q ss_pred ---eeccc-ccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ecCCC
Q 018806 182 ---VRSGA-ASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RGFGG 256 (350)
Q Consensus 182 ---~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~~~~ 256 (350)
+..+. +................|.. . .+.|..++|+|||++||+.+.| |.++|||..+.+..-+. ..-++
T Consensus 260 ~~~~k~~~~f~i~t~ksk~~rNPv~~w~~---~-~g~in~f~FS~DG~~LA~VSqD-GfLRvF~fdt~eLlg~mkSYFGG 334 (636)
T KOG2394|consen 260 YQALKDGDQFAILTSKSKKTRNPVARWHI---G-EGSINEFAFSPDGKYLATVSQD-GFLRIFDFDTQELLGVMKSYFGG 334 (636)
T ss_pred ccccCCCCeeEEeeeeccccCCccceeEe---c-cccccceeEcCCCceEEEEecC-ceEEEeeccHHHHHHHHHhhccc
Confidence 00000 00000000000111111111 1 2578999999999999999999 79999999988765543 34588
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcC
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDP 305 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~ 305 (350)
..|++|||||++|++|++|.-|.||.+..+++. +-.+|..+|+.++|.|
T Consensus 335 LLCvcWSPDGKyIvtGGEDDLVtVwSf~erRVVARGqGHkSWVs~VaFDp 384 (636)
T KOG2394|consen 335 LLCVCWSPDGKYIVTGGEDDLVTVWSFEERRVVARGQGHKSWVSVVAFDP 384 (636)
T ss_pred eEEEEEcCCccEEEecCCcceEEEEEeccceEEEeccccccceeeEeecc
Confidence 999999999999999999999999999998874 4578999999999984
No 182
>PRK03629 tolB translocation protein TolB; Provisional
Probab=99.65 E-value=7.4e-14 Score=125.53 Aligned_cols=176 Identities=18% Similarity=0.295 Sum_probs=122.6
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec---CCcEEEEecCCCCCCceeecccccccceecCCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC---KGGICIWAPSYPGNAASVRSGAASFLGALSRGPG 198 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~---d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~ 198 (350)
.|.+||.+ +.....+. .+...+.+.+|+|||+.+++.+. +..+++|++..+. ...+..
T Consensus 180 ~l~~~d~d---g~~~~~lt-~~~~~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~-~~~l~~-------------- 240 (429)
T PRK03629 180 ELRVSDYD---GYNQFVVH-RSPQPLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGA-VRQVAS-------------- 240 (429)
T ss_pred eEEEEcCC---CCCCEEee-cCCCceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCC-eEEccC--------------
Confidence 57777775 33333443 35668999999999999887654 2568888886322 111111
Q ss_pred CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC-
Q 018806 199 TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD- 275 (350)
Q Consensus 199 ~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d- 275 (350)
+. +.+..++|+|||+.|+......| .|++||+++++...+..+...+....|+|||+.|+..+.+
T Consensus 241 --------~~----~~~~~~~~SPDG~~La~~~~~~g~~~I~~~d~~tg~~~~lt~~~~~~~~~~wSPDG~~I~f~s~~~ 308 (429)
T PRK03629 241 --------FP----RHNGAPAFSPDGSKLAFALSKTGSLNLYVMDLASGQIRQVTDGRSNNTEPTWFPDSQNLAYTSDQA 308 (429)
T ss_pred --------CC----CCcCCeEECCCCCEEEEEEcCCCCcEEEEEECCCCCEEEccCCCCCcCceEECCCCCEEEEEeCCC
Confidence 11 23457899999999987644224 5999999988777766666677889999999999877654
Q ss_pred C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCCC
Q 018806 276 G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFASK 328 (350)
Q Consensus 276 ~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~~ 328 (350)
+ .|+++|+.+++..++...........|+|||++|++... +...++.+++...
T Consensus 309 g~~~Iy~~d~~~g~~~~lt~~~~~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~~g 365 (429)
T PRK03629 309 GRPQVYKVNINGGAPQRITWEGSQNQDADVSSDGKFMVMVSSNGGQQHIAKQDLATG 365 (429)
T ss_pred CCceEEEEECCCCCeEEeecCCCCccCEEECCCCCEEEEEEccCCCceEEEEECCCC
Confidence 3 566668888777666555555677899999999988763 3345666766543
No 183
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.65 E-value=2.4e-14 Score=116.53 Aligned_cols=189 Identities=14% Similarity=0.210 Sum_probs=139.5
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC--CCeEEEEecCCcEEEEecCCCCCCceeecccccc
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN--GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASF 189 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~ 189 (350)
..+|++-..|.|++||..+ ++....+ .++...++.++|..+ ...+++++.||+|++||++.......+..
T Consensus 41 ~~vav~lSngsv~lyd~~t--g~~l~~f-k~~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~----- 112 (376)
T KOG1188|consen 41 TAVAVSLSNGSVRLYDKGT--GQLLEEF-KGPPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISW----- 112 (376)
T ss_pred eeEEEEecCCeEEEEeccc--hhhhhee-cCCCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheec-----
Confidence 5688888999999999964 5555544 578888999999763 44577788899999999996655443322
Q ss_pred cceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe----CCCeEEEEeCCCCCc-ee--eeecCCCeEEEEE
Q 018806 190 LGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY----ESSSFTIWDVAQGLG-TP--IRRGFGGLSILKW 262 (350)
Q Consensus 190 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~----d~g~i~iwd~~~~~~-~~--~~~~~~~v~~~~~ 262 (350)
..+...+..+++..-.++.+++++. + -.|.+||++..+. .. ...|...|++++|
T Consensus 113 ------------------~~~~~~~f~~ld~nck~~ii~~GtE~~~s~-A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrF 173 (376)
T KOG1188|consen 113 ------------------TQQSGTPFICLDLNCKKNIIACGTELTRSD-ASVVLWDVRSEQQLLRQLNESHNDDVTQLRF 173 (376)
T ss_pred ------------------cCCCCCcceEeeccCcCCeEEeccccccCc-eEEEEEEeccccchhhhhhhhccCcceeEEe
Confidence 2222245566666666777777753 3 3899999998765 22 3358899999999
Q ss_pred cCC-CCEEEEEecCCeEEEEeCCCCce----eccccCCCCeEEEEEcCCC--CEEEEEECCCeEEEEEEeCC
Q 018806 263 SPT-GDYFFAAKFDGTFYLWETNTWTS----EPWSSTSGFVTGATWDPEG--RMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 263 sp~-g~~l~~~~~d~~v~iwd~~~~~~----~~~~~~~~~v~~~~~s~~g--~~l~~~~~~~~~~~~~~~~~ 327 (350)
+|. -+.|++|+.||-|.+||++.... .....+...|..+.|..++ +....+...+..+|.|.-.+
T Consensus 174 HP~~pnlLlSGSvDGLvnlfD~~~d~EeDaL~~viN~~sSI~~igw~~~~ykrI~clTH~Etf~~~ele~~~ 245 (376)
T KOG1188|consen 174 HPSDPNLLLSGSVDGLVNLFDTKKDNEEDALLHVINHGSSIHLIGWLSKKYKRIMCLTHMETFAIYELEDGS 245 (376)
T ss_pred cCCCCCeEEeecccceEEeeecCCCcchhhHHHhhcccceeeeeeeecCCcceEEEEEccCceeEEEccCCC
Confidence 995 56789999999999999976543 3456788889999999998 65555556666677665443
No 184
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.65 E-value=6.7e-14 Score=126.30 Aligned_cols=195 Identities=19% Similarity=0.272 Sum_probs=134.7
Q ss_pred CeeEEEEecCCCEEEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-C--CcEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-K--GGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d--~~v~iwd~~ 174 (350)
.+.+.+|+|||++||+++.+ ..|++|++.. +.... + ..+.+.+.+++|+|||+.+++... + ..|++|++.
T Consensus 191 ~~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~--g~~~~-~-~~~~~~~~~~~~spDg~~l~~~~~~~~~~~i~~~d~~ 266 (417)
T TIGR02800 191 PILSPAWSPDGQKLAYVSFESGKPEIYVQDLAT--GQREK-V-ASFPGMNGAPAFSPDGSKLAVSLSKDGNPDIYVMDLD 266 (417)
T ss_pred ceecccCCCCCCEEEEEEcCCCCcEEEEEECCC--CCEEE-e-ecCCCCccceEECCCCCEEEEEECCCCCccEEEEECC
Confidence 58889999999999987654 4788999854 43222 2 234556778999999988876654 3 457788876
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~ 252 (350)
.+. ... +..+. .......|+|||++|++.+...| .|+++|+.+++...+..
T Consensus 267 ~~~-~~~-------------------------l~~~~-~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~~~~~l~~ 319 (417)
T TIGR02800 267 GKQ-LTR-------------------------LTNGP-GIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGGEVRRLTF 319 (417)
T ss_pred CCC-EEE-------------------------CCCCC-CCCCCEEECCCCCEEEEEECCCCCceEEEEECCCCCEEEeec
Confidence 322 111 22221 34456789999999988765433 68888988877666655
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCC---eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECC-C-eEEEEEEeCC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDG---TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAG-S-LTLGSIHFAS 327 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~---~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~-~-~~~~~~~~~~ 327 (350)
+......+.|+|+|++|+.++.++ .|++||+.++....+... ......+|+|||++|+++... . ..++......
T Consensus 320 ~~~~~~~~~~spdg~~i~~~~~~~~~~~i~~~d~~~~~~~~l~~~-~~~~~p~~spdg~~l~~~~~~~~~~~l~~~~~~g 398 (417)
T TIGR02800 320 RGGYNASPSWSPDGDLIAFVHREGGGFNIAVMDLDGGGERVLTDT-GLDESPSFAPNGRMILYATTRGGRGVLGLVSTDG 398 (417)
T ss_pred CCCCccCeEECCCCCEEEEEEccCCceEEEEEeCCCCCeEEccCC-CCCCCceECCCCCEEEEEEeCCCcEEEEEEECCC
Confidence 556677889999999998887765 899999988766544432 234567899999999888732 2 3444444433
No 185
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=99.65 E-value=4.4e-14 Score=112.47 Aligned_cols=99 Identities=25% Similarity=0.495 Sum_probs=77.5
Q ss_pred CceeeEEECCCCCeEEEEE--eCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec---CCeEEEEeCCCCc
Q 018806 213 EQITALSWGPDGRYLASAS--YESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF---DGTFYLWETNTWT 287 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~--~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~~~~ 287 (350)
+.|.+++|+|+|+.+++.. .+ +.|.+||++ ++..... +...+..+.|+|+|++|++++. .|.|.+||.++.+
T Consensus 60 ~~I~~~~WsP~g~~favi~g~~~-~~v~lyd~~-~~~i~~~-~~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~~ 136 (194)
T PF08662_consen 60 GPIHDVAWSPNGNEFAVIYGSMP-AKVTLYDVK-GKKIFSF-GTQPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKKK 136 (194)
T ss_pred CceEEEEECcCCCEEEEEEccCC-cccEEEcCc-ccEeEee-cCCCceEEEECCCCCEEEEEEccCCCcEEEEEECCCCE
Confidence 5799999999999976553 45 489999997 3332222 3567788999999999998864 4679999999877
Q ss_pred eeccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 288 SEPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 288 ~~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
......|. .++.++|+|||++|+++..
T Consensus 137 ~i~~~~~~-~~t~~~WsPdGr~~~ta~t 163 (194)
T PF08662_consen 137 KISTFEHS-DATDVEWSPDGRYLATATT 163 (194)
T ss_pred EeeccccC-cEEEEEEcCCCCEEEEEEe
Confidence 76555554 4789999999999999863
No 186
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.65 E-value=5.4e-15 Score=127.29 Aligned_cols=217 Identities=17% Similarity=0.199 Sum_probs=149.8
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW 152 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~ 152 (350)
+.+.|+||++- |.|+.|+.+|.+|++||.|-.+.|||.. ..+....+..+|...|.+++|
T Consensus 42 lE~eL~GH~GC------------------VN~LeWn~dG~lL~SGSDD~r~ivWd~~--~~KllhsI~TgHtaNIFsvKF 101 (758)
T KOG1310|consen 42 LEAELTGHTGC------------------VNCLEWNADGELLASGSDDTRLIVWDPF--EYKLLHSISTGHTANIFSVKF 101 (758)
T ss_pred hhhhhccccce------------------ecceeecCCCCEEeecCCcceEEeecch--hcceeeeeecccccceeEEee
Confidence 34567888766 9999999999999999999999999985 366677777799999999999
Q ss_pred eeC--CCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEE
Q 018806 153 RPN--GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLAS 229 (350)
Q Consensus 153 sp~--~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~ 229 (350)
-|. ++.+++++.|..|+++|+........ ..+ .......+..|. ..|..++-.|++ ..+.+
T Consensus 102 vP~tnnriv~sgAgDk~i~lfdl~~~~~~~~-d~~--------------~~~~~~~~~cht-~rVKria~~p~~Phtfws 165 (758)
T KOG1310|consen 102 VPYTNNRIVLSGAGDKLIKLFDLDSSKEGGM-DHG--------------MEETTRCWSCHT-DRVKRIATAPNGPHTFWS 165 (758)
T ss_pred eccCCCeEEEeccCcceEEEEeccccccccc-ccC--------------ccchhhhhhhhh-hhhhheecCCCCCceEEE
Confidence 885 34566677799999999983211100 000 001112234455 588899999998 66778
Q ss_pred EEeCCCeEEEEeCCCCCcee--------ee---ecCCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCC--------Cce-
Q 018806 230 ASYESSSFTIWDVAQGLGTP--------IR---RGFGGLSILKWSPTG-DYFFAAKFDGTFYLWETNT--------WTS- 288 (350)
Q Consensus 230 ~~~d~g~i~iwd~~~~~~~~--------~~---~~~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~--------~~~- 288 (350)
++.| |+|+-+|++...... +. ..--...++.++|.. .+|++|+.|--.++||.+. ++.
T Consensus 166 asED-GtirQyDiREph~c~p~~~~~~~l~ny~~~lielk~ltisp~rp~~laVGgsdpfarLYD~Rr~lks~~s~~~~~ 244 (758)
T KOG1310|consen 166 ASED-GTIRQYDIREPHVCNPDEDCPSILVNYNPQLIELKCLTISPSRPYYLAVGGSDPFARLYDRRRVLKSFRSDGTMN 244 (758)
T ss_pred ecCC-cceeeecccCCccCCccccccHHHHHhchhhheeeeeeecCCCCceEEecCCCchhhhhhhhhhccCCCCCcccc
Confidence 8888 899999999742111 00 111346789999965 4678999999999999432 110
Q ss_pred ---------ecc--ccCC-----------CCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 289 ---------EPW--SSTS-----------GFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 289 ---------~~~--~~~~-----------~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
... ..|- ..++-+.|+|+|.-|++.-++. .+|..++..
T Consensus 245 ~~pp~~~~cv~yf~p~hlkn~~gn~~~~~~~~t~vtfnpNGtElLvs~~gE-hVYlfdvn~ 304 (758)
T KOG1310|consen 245 TCPPKDCRCVRYFSPGHLKNSQGNLDRYITCCTYVTFNPNGTELLVSWGGE-HVYLFDVNE 304 (758)
T ss_pred CCCCcccchhheecCccccCcccccccceeeeEEEEECCCCcEEEEeeCCe-EEEEEeecC
Confidence 000 0111 1257789999999988876554 555555543
No 187
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.65 E-value=2e-14 Score=125.78 Aligned_cols=206 Identities=11% Similarity=0.132 Sum_probs=135.7
Q ss_pred eeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCce----------------------eEe--cCCCCCCeeE---EEEe
Q 018806 102 LQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDA----------------------CIL--TSDSQRDVKV---LEWR 153 (350)
Q Consensus 102 V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~----------------------~~~--~~~~~~~v~~---~~~s 153 (350)
|.+++|.|+. ..+++|+.||.|.|||+.-...... ..+ ...+...|.+ +.+.
T Consensus 147 vkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~f 226 (720)
T KOG0321|consen 147 VKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLF 226 (720)
T ss_pred cchhhhccCCCcceeeccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEE
Confidence 8888888865 6788899999999999853210000 000 0123333444 4444
Q ss_pred eCCCeEEEEec-CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCC--CCceeeEEECCCCCeEEEE
Q 018806 154 PNGGRSLSVGC-KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN--GEQITALSWGPDGRYLASA 230 (350)
Q Consensus 154 p~~~~l~~~~~-d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~v~~~~~sp~g~~l~~~ 230 (350)
.|...|+++|. |+.|+|||++............ .+.+..|. .-.+.++.....|.+|++.
T Consensus 227 kDe~tlaSaga~D~~iKVWDLRk~~~~~r~ep~~-----------------~~~~~t~skrs~G~~nL~lDssGt~L~As 289 (720)
T KOG0321|consen 227 KDESTLASAGAADSTIKVWDLRKNYTAYRQEPRG-----------------SDKYPTHSKRSVGQVNLILDSSGTYLFAS 289 (720)
T ss_pred eccceeeeccCCCcceEEEeecccccccccCCCc-----------------ccCccCcccceeeeEEEEecCCCCeEEEE
Confidence 56688888888 8999999998544332221110 01111111 1356778888888999888
Q ss_pred EeCCCeEEEEeCCCCCceeeeecCC-----CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEE
Q 018806 231 SYESSSFTIWDVAQGLGTPIRRGFG-----GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATW 303 (350)
Q Consensus 231 ~~d~g~i~iwd~~~~~~~~~~~~~~-----~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~ 303 (350)
+.| +.|++|++.+-.......+.+ -...-..+|++.+|++|+.|...++|.+.+.+. ..+.+|.-.|+.++|
T Consensus 290 CtD-~sIy~ynm~s~s~sP~~~~sg~~~~sf~vks~lSpd~~~l~SgSsd~~ayiw~vs~~e~~~~~l~Ght~eVt~V~w 368 (720)
T KOG0321|consen 290 CTD-NSIYFYNMRSLSISPVAEFSGKLNSSFYVKSELSPDDCSLLSGSSDEQAYIWVVSSPEAPPALLLGHTREVTTVRW 368 (720)
T ss_pred ecC-CcEEEEeccccCcCchhhccCcccceeeeeeecCCCCceEeccCCCcceeeeeecCccCChhhhhCcceEEEEEee
Confidence 889 499999998765544333222 122345789999999999999999999998776 456789999999999
Q ss_pred cCCCCE-EEEEECCCeEEEEEEeC
Q 018806 304 DPEGRM-ILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 304 s~~g~~-l~~~~~~~~~~~~~~~~ 326 (350)
.|.... ++++ .++..+..|++.
T Consensus 369 ~pS~~t~v~Tc-SdD~~~kiW~l~ 391 (720)
T KOG0321|consen 369 LPSATTPVATC-SDDFRVKIWRLS 391 (720)
T ss_pred ccccCCCceee-ccCcceEEEecc
Confidence 885433 3334 444555566554
No 188
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=99.64 E-value=2.8e-14 Score=113.78 Aligned_cols=229 Identities=16% Similarity=0.240 Sum_probs=161.7
Q ss_pred CeeEEEEec--C-CCEEEEEEC----CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC----eEEEEecCCcEE
Q 018806 101 DLQGVSWHQ--H-KHIVAFISG----STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG----RSLSVGCKGGIC 169 (350)
Q Consensus 101 ~V~~v~~sp--~-g~~la~~s~----d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~----~l~~~~~d~~v~ 169 (350)
.+.++.||. + +.+||.|+. .+.|.|..++..+++....-...|.-+++.+.|.|+.. .+++ +++..++
T Consensus 46 ~lya~~Ws~~~~~~~rla~gS~~Ee~~Nkvqiv~ld~~s~e~~~~a~fd~~YP~tK~~wiPd~~g~~pdlLA-Ts~D~LR 124 (364)
T KOG0290|consen 46 PLYAMNWSVRPDKKFRLAVGSFIEEYNNKVQIVQLDEDSGELVEDANFDHPYPVTKLMWIPDSKGVYPDLLA-TSSDFLR 124 (364)
T ss_pred ceeeeccccCCCcceeEEEeeeccccCCeeEEEEEccCCCceeccCCCCCCCCccceEecCCccccCcchhh-cccCeEE
Confidence 578888883 2 358888873 57888888876666655555557999999999999842 2444 4456799
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCC--
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGL-- 246 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~-- 246 (350)
+|.+............ +......+...+++++.|+. +-++|.+++-|. ++.|||+.++.
T Consensus 125 lWri~~ee~~~~~~~~-----------------L~~~kns~~~aPlTSFDWne~dp~~igtSSiDT-TCTiWdie~~~~~ 186 (364)
T KOG0290|consen 125 LWRIGDEESRVELQSV-----------------LNNNKNSEFCAPLTSFDWNEVDPNLIGTSSIDT-TCTIWDIETGVSG 186 (364)
T ss_pred EEeccCcCCceehhhh-----------------hccCcccccCCcccccccccCCcceeEeecccC-eEEEEEEeecccc
Confidence 9998843221111110 00011223346899999986 667888999995 99999999873
Q ss_pred --ceeeeecCCCeEEEEEcCCCC-EEEEEecCCeEEEEeCCCCceecccc----CCCCeEEEEEcCCC-CEEEEEEC--C
Q 018806 247 --GTPIRRGFGGLSILKWSPTGD-YFFAAKFDGTFYLWETNTWTSEPWSS----TSGFVTGATWDPEG-RMILLAFA--G 316 (350)
Q Consensus 247 --~~~~~~~~~~v~~~~~sp~g~-~l~~~~~d~~v~iwd~~~~~~~~~~~----~~~~v~~~~~s~~g-~~l~~~~~--~ 316 (350)
..++..|...|..++|...+. .+|+.+.||.|++||++..+..++.. ...+...++|+++. +++|+-.- .
T Consensus 187 ~vkTQLIAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~ 266 (364)
T KOG0290|consen 187 TVKTQLIAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSN 266 (364)
T ss_pred ceeeEEEecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCc
Confidence 345778999999999998665 56889999999999999887654432 24578899999866 44554433 3
Q ss_pred CeEEEEEEeCCCCC-CCceeecccccceeeccc
Q 018806 317 SLTLGSIHFASKPP-SLDAHLLPVDLPDIVSLT 348 (350)
Q Consensus 317 ~~~~~~~~~~~~~~-~~~~~~~~v~~~~~~~~~ 348 (350)
.+.+.++++...+. .+.+|...|.+..+.+-+
T Consensus 267 ~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS 299 (364)
T KOG0290|consen 267 KVVILDIRVPCTPVARLRNHQASVNGIAWAPHS 299 (364)
T ss_pred eEEEEEecCCCcceehhhcCcccccceEecCCC
Confidence 35555566655554 889999999988887654
No 189
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.63 E-value=4.8e-14 Score=113.29 Aligned_cols=157 Identities=9% Similarity=0.172 Sum_probs=124.5
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
......|.++.|+|.++.|++++.||.+++|++........+ .| ..++.+.+|
T Consensus 10 npP~d~IS~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~--------------------------~~-~~plL~c~F 62 (323)
T KOG1036|consen 10 NPPEDGISSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKF--------------------------KH-GAPLLDCAF 62 (323)
T ss_pred CCChhceeeEEEcCcCCcEEEEeccCcEEEEeccchhhhhhe--------------------------ec-CCceeeeec
Confidence 345678999999999999999999999999999844222211 12 369999999
Q ss_pred CCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEE
Q 018806 221 GPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTG 300 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~ 300 (350)
.+ ...+++++.| |.|+.+|+.++....+..|..++.++.+++-...+++|+.|++|++||.+.....-.......|.+
T Consensus 63 ~d-~~~~~~G~~d-g~vr~~Dln~~~~~~igth~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~kkVy~ 140 (323)
T KOG1036|consen 63 AD-ESTIVTGGLD-GQVRRYDLNTGNEDQIGTHDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQGKKVYC 140 (323)
T ss_pred cC-CceEEEeccC-ceEEEEEecCCcceeeccCCCceEEEEeeccCCeEEEcccCccEEEEeccccccccccccCceEEE
Confidence 87 4678899999 799999999999988999999999999999888899999999999999997544444445557887
Q ss_pred EEEcCCCCEEEEEE-CCCeEEEEEEeCCC
Q 018806 301 ATWDPEGRMILLAF-AGSLTLGSIHFASK 328 (350)
Q Consensus 301 ~~~s~~g~~l~~~~-~~~~~~~~~~~~~~ 328 (350)
+..+ |..|++|+ +..+.+|+++.-..
T Consensus 141 ~~v~--g~~LvVg~~~r~v~iyDLRn~~~ 167 (323)
T KOG1036|consen 141 MDVS--GNRLVVGTSDRKVLIYDLRNLDE 167 (323)
T ss_pred Eecc--CCEEEEeecCceEEEEEcccccc
Confidence 7655 66777766 55566777665543
No 190
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.62 E-value=1.9e-14 Score=115.98 Aligned_cols=151 Identities=18% Similarity=0.247 Sum_probs=115.3
Q ss_pred eeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCe
Q 018806 147 VKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRY 226 (350)
Q Consensus 147 v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~ 226 (350)
..++.|++.|..++.+..+|.|.|||+.+.+ .-+.+.+|. .+|++++||+||+.
T Consensus 26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~-------------------------iar~lsaH~-~pi~sl~WS~dgr~ 79 (405)
T KOG1273|consen 26 AECCQFSRWGDYLAVGCANGRVVIYDFDTFR-------------------------IARMLSAHV-RPITSLCWSRDGRK 79 (405)
T ss_pred cceEEeccCcceeeeeccCCcEEEEEccccc-------------------------hhhhhhccc-cceeEEEecCCCCE
Confidence 7899999998888888889999999998433 234466776 69999999999999
Q ss_pred EEEEEeCCCeEEEEeCCCCCceeeeecCCC-----------------------------------------------eEE
Q 018806 227 LASASYESSSFTIWDVAQGLGTPIRRGFGG-----------------------------------------------LSI 259 (350)
Q Consensus 227 l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~-----------------------------------------------v~~ 259 (350)
|++++.|. .|.+||+..|.+........+ ..+
T Consensus 80 LltsS~D~-si~lwDl~~gs~l~rirf~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~ 158 (405)
T KOG1273|consen 80 LLTSSRDW-SIKLWDLLKGSPLKRIRFDSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASH 158 (405)
T ss_pred eeeecCCc-eeEEEeccCCCceeEEEccCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCcccccccccc
Confidence 99999996 999999998843211111110 112
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-cC-CCCeEEEEEcCCCCEEEEEE-CCCeEEEEEE
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-ST-SGFVTGATWDPEGRMILLAF-AGSLTLGSIH 324 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-~~-~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~ 324 (350)
..|.+.|++|++|...|.+.+||..+.++.... -. ...|.++.++..|+.|++-+ +..++.+.++
T Consensus 159 ~~fdr~g~yIitGtsKGkllv~~a~t~e~vas~rits~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~ 226 (405)
T KOG1273|consen 159 GVFDRRGKYIITGTSKGKLLVYDAETLECVASFRITSVQAIKQIIVSRKGRFLIINTSDRVIRTYEIS 226 (405)
T ss_pred ccccCCCCEEEEecCcceEEEEecchheeeeeeeechheeeeEEEEeccCcEEEEecCCceEEEEehh
Confidence 236677899999999999999999998874322 22 36789999999999999877 5556666655
No 191
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.62 E-value=3.8e-14 Score=113.29 Aligned_cols=229 Identities=18% Similarity=0.245 Sum_probs=150.5
Q ss_pred hhhhhhccccccCCCCcCCCCc--c----------------------CeeEEEEecCC---CEEEEEECCCeEEEEEccC
Q 018806 78 HGIISHSIKPLLHPDHVHLLPE--V----------------------DLQGVSWHQHK---HIVAFISGSTQVIVRDYED 130 (350)
Q Consensus 78 ~gh~~~~~~~~~~p~~~~~~~~--~----------------------~V~~v~~sp~g---~~la~~s~d~~i~iw~~~~ 130 (350)
.||...+-...++|-+.-+... + .|++-++||-. .+||+|..+-.|++.|+..
T Consensus 98 ~~Hky~iss~~WyP~DtGmFtssSFDhtlKVWDtnTlQ~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~S 177 (397)
T KOG4283|consen 98 NGHKYAISSAIWYPIDTGMFTSSSFDHTLKVWDTNTLQEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIAS 177 (397)
T ss_pred ccceeeeeeeEEeeecCceeecccccceEEEeecccceeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccC
Confidence 3676677777777754332221 1 46666777633 4677777888888888844
Q ss_pred CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCC-CCCceeecccccccceecCCCCCceEEeeecc
Q 018806 131 SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYP-GNAASVRSGAASFLGALSRGPGTRWTLVDFLR 208 (350)
Q Consensus 131 ~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 208 (350)
|.....+ .+|.+.|.++.|+|..+.+++.++ ||.|++||++.. +....+.... ..+-...+.-.
T Consensus 178 --Gs~sH~L-sGHr~~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn-----------~k~~p~~~~n~ 243 (397)
T KOG4283|consen 178 --GSFSHTL-SGHRDGVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHN-----------TKRPPILKTNT 243 (397)
T ss_pred --Ccceeee-ccccCceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeeccc-----------CccCccccccc
Confidence 6666666 589999999999999888777666 899999999843 2111111110 00001122233
Q ss_pred CCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee----ecC---CCeEEEEEcCCCCEEEEEecCCeEEEE
Q 018806 209 SQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR----RGF---GGLSILKWSPTGDYFFAAKFDGTFYLW 281 (350)
Q Consensus 209 ~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~----~~~---~~v~~~~~sp~g~~l~~~~~d~~v~iw 281 (350)
.|. +.+..++|+.+|.++++++.|+ .+++|+..+|...... .++ +.-..+. +.+...++.--.++.+.++
T Consensus 244 ah~-gkvngla~tSd~~~l~~~gtd~-r~r~wn~~~G~ntl~~~g~~~~n~~~~~~~~~~-~~~s~vfv~~p~~~~lall 320 (397)
T KOG4283|consen 244 AHY-GKVNGLAWTSDARYLASCGTDD-RIRVWNMESGRNTLREFGPIIHNQTTSFAVHIQ-SMDSDVFVLFPNDGSLALL 320 (397)
T ss_pred ccc-ceeeeeeecccchhhhhccCcc-ceEEeecccCcccccccccccccccccceEEEe-ecccceEEEEecCCeEEEE
Confidence 454 7999999999999999999996 9999999988532111 111 1111122 3344444444556899999
Q ss_pred eCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 282 ETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 282 d~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
++-.+.. ..+..|...+.+.++-|+=+...++. +..+..|..
T Consensus 321 ~~~sgs~ir~l~~h~k~i~c~~~~~~fq~~~tg~~d~ni~~w~p 364 (397)
T KOG4283|consen 321 NLLEGSFVRRLSTHLKRINCAAYRPDFEQCFTGDMNGNIYMWSP 364 (397)
T ss_pred EccCceEEEeeecccceeeEEeecCchhhhhccccCCccccccc
Confidence 9988887 45667888899999999988888775 433443433
No 192
>PRK04922 tolB translocation protein TolB; Provisional
Probab=99.62 E-value=1.3e-13 Score=124.43 Aligned_cols=176 Identities=19% Similarity=0.293 Sum_probs=121.7
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCCCCCceeecccccccceecCCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYPGNAASVRSGAASFLGALSRGPG 198 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~ 198 (350)
.|.+||.+ +.....+. .+...+.+++|+|||+.+++++.+ ..+++||+..+.. ..
T Consensus 185 ~l~i~D~~---g~~~~~lt-~~~~~v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~-~~----------------- 242 (433)
T PRK04922 185 ALQVADSD---GYNPQTIL-RSAEPILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQR-EL----------------- 242 (433)
T ss_pred EEEEECCC---CCCceEee-cCCCccccccCCCCCCEEEEEecCCCCcEEEEEECCCCCE-EE-----------------
Confidence 57788874 33334443 456789999999999988887753 4688999863321 11
Q ss_pred CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec-C
Q 018806 199 TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF-D 275 (350)
Q Consensus 199 ~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d 275 (350)
+... .+...+++|+|||+.|+.....+| .|++||+.+++...+..+......++|+|||++|+..+. +
T Consensus 243 --------l~~~-~g~~~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~~~g~~~~lt~~~~~~~~~~~spDG~~l~f~sd~~ 313 (433)
T PRK04922 243 --------VASF-RGINGAPSFSPDGRRLALTLSRDGNPEIYVMDLGSRQLTRLTNHFGIDTEPTWAPDGKSIYFTSDRG 313 (433)
T ss_pred --------eccC-CCCccCceECCCCCEEEEEEeCCCCceEEEEECCCCCeEECccCCCCccceEECCCCCEEEEEECCC
Confidence 1111 134457899999998875533223 699999998877666655555667899999999887764 3
Q ss_pred C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCCC
Q 018806 276 G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFASK 328 (350)
Q Consensus 276 ~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~~ 328 (350)
+ .|+++|+.+++...+.........++|+|||++|++... +...++.+++...
T Consensus 314 g~~~iy~~dl~~g~~~~lt~~g~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~~g 370 (433)
T PRK04922 314 GRPQIYRVAASGGSAERLTFQGNYNARASVSPDGKKIAMVHGSGGQYRIAVMDLSTG 370 (433)
T ss_pred CCceEEEEECCCCCeEEeecCCCCccCEEECCCCCEEEEEECCCCceeEEEEECCCC
Confidence 4 477888888777655544445567899999999998763 2346777776443
No 193
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.61 E-value=2.4e-14 Score=123.07 Aligned_cols=168 Identities=20% Similarity=0.265 Sum_probs=126.7
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccc
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLG 191 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~ 191 (350)
..++.++.||.+.|.+-. ++....+ ..|.+.+.+-+|+|||.-++++|.||.|++|.-. +..
T Consensus 76 d~~~i~s~DGkf~il~k~---~rVE~sv-~AH~~A~~~gRW~~dGtgLlt~GEDG~iKiWSrs-GML------------- 137 (737)
T KOG1524|consen 76 DTLLICSNDGRFVILNKS---ARVERSI-SAHAAAISSGRWSPDGAGLLTAGEDGVIKIWSRS-GML------------- 137 (737)
T ss_pred ceEEEEcCCceEEEeccc---chhhhhh-hhhhhhhhhcccCCCCceeeeecCCceEEEEecc-chH-------------
Confidence 567788999999888743 4333333 4799999999999999999999999999999865 111
Q ss_pred eecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-CceeeeecCCCeEEEEEcCCCCEEE
Q 018806 192 ALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-LGTPIRRGFGGLSILKWSPTGDYFF 270 (350)
Q Consensus 192 ~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-~~~~~~~~~~~v~~~~~sp~g~~l~ 270 (350)
+.........|.|++|.|+...++.+..+ .+.|=.+... +......|++-|.++.|++....++
T Consensus 138 -------------RStl~Q~~~~v~c~~W~p~S~~vl~c~g~--h~~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~ 202 (737)
T KOG1524|consen 138 -------------RSTVVQNEESIRCARWAPNSNSIVFCQGG--HISIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIA 202 (737)
T ss_pred -------------HHHHhhcCceeEEEEECCCCCceEEecCC--eEEEeecccccceeEEeccCcEEEEeecCcccccee
Confidence 11111124689999999999888887654 6777666544 3456678999999999999999999
Q ss_pred EEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEE
Q 018806 271 AAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 271 ~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
+|++|-..+|||...........|+.+|++++|.|+ +.++++
T Consensus 203 sgGED~kfKvWD~~G~~Lf~S~~~ey~ITSva~npd-~~~~v~ 244 (737)
T KOG1524|consen 203 SGGEDFRFKIWDAQGANLFTSAAEEYAITSVAFNPE-KDYLLW 244 (737)
T ss_pred ecCCceeEEeecccCcccccCChhccceeeeeeccc-cceeee
Confidence 999999999999876555555566667777777776 333334
No 194
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=99.61 E-value=2.6e-13 Score=111.50 Aligned_cols=190 Identities=18% Similarity=0.373 Sum_probs=129.7
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCC--Cc--------eeEec-CCCCCCeeEEEEeeCCCeEEEEec-C
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEG--KD--------ACILT-SDSQRDVKVLEWRPNGGRSLSVGC-K 165 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~--~~--------~~~~~-~~~~~~v~~~~~sp~~~~l~~~~~-d 165 (350)
..+|+|++|-|.+ +-|+.|...| |.||..+.... .. ...+. .+| .+|++++|++||..+++++. +
T Consensus 140 QrnvtclawRPlsaselavgCr~g-IciW~~s~tln~~r~~~~~s~~~~qvl~~pgh-~pVtsmqwn~dgt~l~tAS~gs 217 (445)
T KOG2139|consen 140 QRNVTCLAWRPLSASELAVGCRAG-ICIWSDSRTLNANRNIRMMSTHHLQVLQDPGH-NPVTSMQWNEDGTILVTASFGS 217 (445)
T ss_pred hcceeEEEeccCCcceeeeeecce-eEEEEcCcccccccccccccccchhheeCCCC-ceeeEEEEcCCCCEEeecccCc
Confidence 4489999999976 5677777766 88998752111 10 01111 134 58999999999998888887 5
Q ss_pred CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC-C
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA-Q 244 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~-~ 244 (350)
..|.|||.+.+........ ..+.++-+.|||||.+|++++-| +..++|+.. +
T Consensus 218 ssi~iWdpdtg~~~pL~~~--------------------------glgg~slLkwSPdgd~lfaAt~d-avfrlw~e~q~ 270 (445)
T KOG2139|consen 218 SSIMIWDPDTGQKIPLIPK--------------------------GLGGFSLLKWSPDGDVLFAATCD-AVFRLWQENQS 270 (445)
T ss_pred ceEEEEcCCCCCccccccc--------------------------CCCceeeEEEcCCCCEEEEeccc-ceeeeehhccc
Confidence 9999999996654433211 13678899999999999999999 699999544 3
Q ss_pred CCceeeeecCCCeEEEEEcCCCCEEEEE-ecCCeEEEEeCCCCc----------eecc---------cc----CCCCeEE
Q 018806 245 GLGTPIRRGFGGLSILKWSPTGDYFFAA-KFDGTFYLWETNTWT----------SEPW---------SS----TSGFVTG 300 (350)
Q Consensus 245 ~~~~~~~~~~~~v~~~~~sp~g~~l~~~-~~d~~v~iwd~~~~~----------~~~~---------~~----~~~~v~~ 300 (350)
....+.....+.|...+|+|+|++|+.. +..-.++-....... ...+ .. ..+++.+
T Consensus 271 wt~erw~lgsgrvqtacWspcGsfLLf~~sgsp~lysl~f~~~~~~~~~~~~~k~~lliaDL~e~ti~ag~~l~cgeaq~ 350 (445)
T KOG2139|consen 271 WTKERWILGSGRVQTACWSPCGSFLLFACSGSPRLYSLTFDGEDSVFLRPQSIKRVLLIADLQEVTICAGQRLCCGEAQC 350 (445)
T ss_pred ceecceeccCCceeeeeecCCCCEEEEEEcCCceEEEEeecCCCccccCcccceeeeeeccchhhhhhcCcccccCccce
Confidence 3344444556799999999999987544 333333332221110 0000 01 1467899
Q ss_pred EEEcCCCCEEEEEECCC
Q 018806 301 ATWDPEGRMILLAFAGS 317 (350)
Q Consensus 301 ~~~s~~g~~l~~~~~~~ 317 (350)
++|.|.|.+|++...+.
T Consensus 351 lawDpsGeyLav~fKg~ 367 (445)
T KOG2139|consen 351 LAWDPSGEYLAVIFKGQ 367 (445)
T ss_pred eeECCCCCEEEEEEcCC
Confidence 99999999999987444
No 195
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.60 E-value=5.7e-13 Score=109.71 Aligned_cols=192 Identities=15% Similarity=0.189 Sum_probs=133.3
Q ss_pred eeEEEEecCCCEEEEEECC--CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGS--TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d--~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
|-.+-||. .++|..+.+ +.+++.++. ....++.+. ...+|.+++++.+ +++++-.+. |+|||+...+..
T Consensus 49 IvEmLFSS--SLvaiV~~~qpr~Lkv~~~K--k~~~ICe~~--fpt~IL~VrmNr~--RLvV~Lee~-IyIydI~~MklL 119 (391)
T KOG2110|consen 49 IVEMLFSS--SLVAIVSIKQPRKLKVVHFK--KKTTICEIF--FPTSILAVRMNRK--RLVVCLEES-IYIYDIKDMKLL 119 (391)
T ss_pred EEEeeccc--ceeEEEecCCCceEEEEEcc--cCceEEEEe--cCCceEEEEEccc--eEEEEEccc-EEEEecccceee
Confidence 44445554 456655543 458888884 466667665 3457999999754 555555544 999999843332
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEE-EeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASA-SYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~-~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
..+.. ... +...+.++++++.+.+++.- +.+.|.|.+||+.+-+... +..|++.+
T Consensus 120 hTI~t----------------------~~~-n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~aH~~~l 176 (391)
T KOG2110|consen 120 HTIET----------------------TPP-NPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTINAHKGPL 176 (391)
T ss_pred hhhhc----------------------cCC-CccceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEEecCCce
Confidence 22221 111 23456777777777788864 4455899999999877654 55799999
Q ss_pred EEEEEcCCCCEEEEEecCCe-EEEEeCCCCcee-ccccC--CCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 258 SILKWSPTGDYFFAAKFDGT-FYLWETNTWTSE-PWSST--SGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~-v~iwd~~~~~~~-~~~~~--~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
.+++|+++|.+||++++.|+ |||+.+.+|+.. ++... ...|.+++|+|++++|++++ .+.+.++.+..
T Consensus 177 Aalafs~~G~llATASeKGTVIRVf~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~sS~TeTVHiFKL~~ 249 (391)
T KOG2110|consen 177 AALAFSPDGTLLATASEKGTVIRVFSVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAASSNTETVHIFKLEK 249 (391)
T ss_pred eEEEECCCCCEEEEeccCceEEEEEEcCCccEeeeeeCCceeeEEEEEEECCCCCeEEEecCCCeEEEEEecc
Confidence 99999999999999999885 799999999874 33322 34688999999999998776 44455555543
No 196
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.60 E-value=4.2e-14 Score=127.38 Aligned_cols=172 Identities=16% Similarity=0.164 Sum_probs=121.7
Q ss_pred eeEEEEecCCCEEEEEE-CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAFIS-GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s-~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~ 179 (350)
..+++|+|||++|++++ .+|.+.||.++..++. ...+. .+...+..+.|+|||+.+++++. ++...||+++..+..
T Consensus 250 ~~~~~wSPDG~~La~~~~~~g~~~Iy~~d~~~~~-~~~lt-~~~~~~~~~~wSpDG~~i~f~s~~~g~~~I~~~~~~~~~ 327 (429)
T PRK01742 250 NGAPAFSPDGSRLAFASSKDGVLNIYVMGANGGT-PSQLT-SGAGNNTEPSWSPDGQSILFTSDRSGSPQVYRMSASGGG 327 (429)
T ss_pred cCceeECCCCCEEEEEEecCCcEEEEEEECCCCC-eEeec-cCCCCcCCEEECCCCCEEEEEECCCCCceEEEEECCCCC
Confidence 45789999999998865 6887777766543343 33443 45667889999999988887765 588899987643321
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSI 259 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~ 259 (350)
... + .+. . ...+|+|||++|++.+.+ .+.+||+.+++...+... .....
T Consensus 328 ~~~------------------------l-~~~-~--~~~~~SpDG~~ia~~~~~--~i~~~Dl~~g~~~~lt~~-~~~~~ 376 (429)
T PRK01742 328 ASL------------------------V-GGR-G--YSAQISADGKTLVMINGD--NVVKQDLTSGSTEVLSST-FLDES 376 (429)
T ss_pred eEE------------------------e-cCC-C--CCccCCCCCCEEEEEcCC--CEEEEECCCCCeEEecCC-CCCCC
Confidence 111 1 121 2 457899999999988776 466799998876544332 23456
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCC--CCc-eeccccCCCCeEEEEEcCC
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETN--TWT-SEPWSSTSGFVTGATWDPE 306 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~--~~~-~~~~~~~~~~v~~~~~s~~ 306 (350)
+.|+|||++|++++.++.+.+|.+. +++ ...+..+.+.+..++|+|-
T Consensus 377 ~~~sPdG~~i~~~s~~g~~~~l~~~~~~G~~~~~l~~~~g~~~~p~wsp~ 426 (429)
T PRK01742 377 PSISPNGIMIIYSSTQGLGKVLQLVSADGRFKARLPGSDGQVKFPAWSPY 426 (429)
T ss_pred ceECCCCCEEEEEEcCCCceEEEEEECCCCceEEccCCCCCCCCcccCCC
Confidence 8899999999999888877777642 344 4566677888899999984
No 197
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.60 E-value=4.7e-14 Score=111.04 Aligned_cols=217 Identities=16% Similarity=0.169 Sum_probs=139.6
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..|+++.|-.+++ |.+|...|.+++|++.+ ......+...+...|+.+.--|+ ..+.+-+.|..+.+|++......
T Consensus 15 ~~v~s~~fqa~~r-L~sg~~~G~V~~w~lqt--~r~~~~~r~~g~~~it~lq~~p~-d~l~tqgRd~~L~lw~ia~s~~i 90 (323)
T KOG0322|consen 15 SSVTSVLFQANER-LMSGLSVGIVKMWVLQT--ERDLPLIRLFGRLFITNLQSIPN-DSLDTQGRDPLLILWTIAYSAFI 90 (323)
T ss_pred chheehhhccchh-hhcccccceEEEEEeec--CccchhhhhhccceeeceeecCC-cchhhcCCCceEEEEEccCcceE
Confidence 3588888887776 77899999999999964 33333332246778999999998 78999999999999999852211
Q ss_pred ce--------------eecccccccceecCCCCCc-------------eEEee-eccCCCCCceeeEEECCC--CCeEEE
Q 018806 180 AS--------------VRSGAASFLGALSRGPGTR-------------WTLVD-FLRSQNGEQITALSWGPD--GRYLAS 229 (350)
Q Consensus 180 ~~--------------~~~~~~~~~~~~~~~~~~~-------------~~~~~-~~~~~~~~~v~~~~~sp~--g~~l~~ 229 (350)
.. +..........+.....+. ....+ .-.+. .+.+++..+..+ .+.++.
T Consensus 91 ~i~Si~~nslgFCrfSl~~~~k~~eqll~yp~rgsde~h~~D~g~~tqv~i~dd~~~~K-lgsvmc~~~~~~c~s~~lll 169 (323)
T KOG0322|consen 91 SIHSIVVNSLGFCRFSLVKKPKNSEQLLEYPSRGSDETHKQDGGDTTQVQIADDSERSK-LGSVMCQDKDHACGSTFLLL 169 (323)
T ss_pred EEeeeeccccccccceeccCCCcchhheecCCcccchhhhhccCccceeEccCchhccc-cCceeeeeccccccceEEEE
Confidence 10 0000000000000000000 00000 01111 246666665432 344556
Q ss_pred EEeCCCeEEEEeCCCCCc---------------------------------------------------------eeeee
Q 018806 230 ASYESSSFTIWDVAQGLG---------------------------------------------------------TPIRR 252 (350)
Q Consensus 230 ~~~d~g~i~iwd~~~~~~---------------------------------------------------------~~~~~ 252 (350)
++.++|.+.+||+.++.. ..+..
T Consensus 170 aGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~ash~qpvlsldyas~~~rGisgga~dkl~~~Sl~~s~gslq~~~e~~l 249 (323)
T KOG0322|consen 170 AGYESGHVVIWDLSTGDKIIQLPQSSKVESPNASHKQPVLSLDYASSCDRGISGGADDKLVMYSLNHSTGSLQIRKEITL 249 (323)
T ss_pred EeccCCeEEEEEccCCceeeccccccccccchhhccCcceeeeechhhcCCcCCCccccceeeeeccccCcccccceEEe
Confidence 666668999999987500 00001
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEE
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLG 321 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~ 321 (350)
.+.++..+.+-||++.+|+++.|+.|+||+.++.... .+..|...|.+++|+|+...+|.++ |..+.+|
T Consensus 250 knpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLkyHsagvn~vAfspd~~lmAaaskD~rISLW 320 (323)
T KOG0322|consen 250 KNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVAFSPDCELMAAASKDARISLW 320 (323)
T ss_pred cCCCccceEEccCCcEEeecccCCcEEEEEeccCCchhhhhhhhcceeEEEeCCCCchhhhccCCceEEee
Confidence 1234566778899999999999999999999998874 5678999999999999988888776 4444444
No 198
>PRK02889 tolB translocation protein TolB; Provisional
Probab=99.60 E-value=5.1e-13 Score=120.24 Aligned_cols=184 Identities=17% Similarity=0.233 Sum_probs=116.2
Q ss_pred EEEEEECC-C--eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCCCCCceeeccc
Q 018806 113 IVAFISGS-T--QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYPGNAASVRSGA 186 (350)
Q Consensus 113 ~la~~s~d-~--~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~ 186 (350)
.||..+.. + .|.++|.+ +.....+. .+...+.+.+|+|||+.+++.+.+ ..|.+||+..+.. ..+
T Consensus 165 ~iayv~~~~~~~~L~~~D~d---G~~~~~l~-~~~~~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~-~~l---- 235 (427)
T PRK02889 165 RIAYVIKTGNRYQLQISDAD---GQNAQSAL-SSPEPIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRR-RVV---- 235 (427)
T ss_pred EEEEEEccCCccEEEEECCC---CCCceEec-cCCCCcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCE-EEe----
Confidence 45544432 3 45555543 44434443 466789999999999888887753 4589999874321 111
Q ss_pred ccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEE--EeCCCCCceeeeecCCCeEEEEEcC
Q 018806 187 ASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTI--WDVAQGLGTPIRRGFGGLSILKWSP 264 (350)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~i--wd~~~~~~~~~~~~~~~v~~~~~sp 264 (350)
... .+.+...+|+|||+.|+.....+|...+ +|+.++....+..+........|+|
T Consensus 236 ---------------------~~~-~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~~~~lt~~~~~~~~~~wSp 293 (427)
T PRK02889 236 ---------------------ANF-KGSNSAPAWSPDGRTLAVALSRDGNSQIYTVNADGSGLRRLTQSSGIDTEPFFSP 293 (427)
T ss_pred ---------------------ecC-CCCccceEECCCCCEEEEEEccCCCceEEEEECCCCCcEECCCCCCCCcCeEEcC
Confidence 111 1355688999999998865433355444 5666665555555555566789999
Q ss_pred CCCEEEEEec-CCeEEEE--eCCCCceeccccCCCCeEEEEEcCCCCEEEEEECC--CeEEEEEEeCC
Q 018806 265 TGDYFFAAKF-DGTFYLW--ETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAG--SLTLGSIHFAS 327 (350)
Q Consensus 265 ~g~~l~~~~~-d~~v~iw--d~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~--~~~~~~~~~~~ 327 (350)
||++|+..+. ++...|| ++.+++...+..........+|||||++|++.+.. ...++.+++..
T Consensus 294 DG~~l~f~s~~~g~~~Iy~~~~~~g~~~~lt~~g~~~~~~~~SpDG~~Ia~~s~~~g~~~I~v~d~~~ 361 (427)
T PRK02889 294 DGRSIYFTSDRGGAPQIYRMPASGGAAQRVTFTGSYNTSPRISPDGKLLAYISRVGGAFKLYVQDLAT 361 (427)
T ss_pred CCCEEEEEecCCCCcEEEEEECCCCceEEEecCCCCcCceEECCCCCEEEEEEccCCcEEEEEEECCC
Confidence 9999876654 3444444 55666654444333445578999999999987632 24567777654
No 199
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.59 E-value=3.6e-14 Score=114.98 Aligned_cols=185 Identities=13% Similarity=0.160 Sum_probs=129.2
Q ss_pred CCCccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEec--CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEe
Q 018806 96 LLPEVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILT--SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWA 172 (350)
Q Consensus 96 ~~~~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~--~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd 172 (350)
..++..|+.+.++|+. ++|+++|.|..|++|++.+ ..++..+- .+|.+.|.++.|+++|.+++++|.|..+++|+
T Consensus 132 ~ghG~sINeik~~p~~~qlvls~SkD~svRlwnI~~--~~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~ 209 (385)
T KOG1034|consen 132 RGHGGSINEIKFHPDRPQLVLSASKDHSVRLWNIQT--DVCVAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWR 209 (385)
T ss_pred eccCccchhhhcCCCCCcEEEEecCCceEEEEeccC--CeEEEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEe
Confidence 4457789999999976 7899999999999999954 55555442 36999999999999999999999999999999
Q ss_pred cCCCCCCceeec---------------c-cccccc-------------------eecCCCCCceEEeee-----------
Q 018806 173 PSYPGNAASVRS---------------G-AASFLG-------------------ALSRGPGTRWTLVDF----------- 206 (350)
Q Consensus 173 ~~~~~~~~~~~~---------------~-~~~~~~-------------------~~~~~~~~~~~~~~~----------- 206 (350)
+..+.....+.. . ...+.. .++-+..+.+.+|..
T Consensus 210 l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~~~~vk 289 (385)
T KOG1034|consen 210 LNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEESIHNVK 289 (385)
T ss_pred cChhHHhhhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhhhhccC
Confidence 983321111110 0 000000 022233333334432
Q ss_pred -----------ccCCCCCceeeE--EECCCCCeEEEEEeCCCeEEEEeCCCCCcee---eeec--CCCeEEEEEcCCCCE
Q 018806 207 -----------LRSQNGEQITAL--SWGPDGRYLASASYESSSFTIWDVAQGLGTP---IRRG--FGGLSILKWSPTGDY 268 (350)
Q Consensus 207 -----------~~~~~~~~v~~~--~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~---~~~~--~~~v~~~~~sp~g~~ 268 (350)
+.-. ...|+.+ +|.|-++.|+.+... |.|.+||++...... +..+ ...|...+|+.||.+
T Consensus 290 p~es~~Ti~~~~~~~-~c~iWfirf~~d~~~~~la~gnq~-g~v~vwdL~~~ep~~~ttl~~s~~~~tVRQ~sfS~dgs~ 367 (385)
T KOG1034|consen 290 PPESATTILGEFDYP-MCDIWFIRFAFDPWQKMLALGNQS-GKVYVWDLDNNEPPKCTTLTHSKSGSTVRQTSFSRDGSI 367 (385)
T ss_pred CCccceeeeeEeccC-ccceEEEEEeecHHHHHHhhccCC-CcEEEEECCCCCCccCceEEeccccceeeeeeecccCcE
Confidence 1111 1234444 456778899999988 799999999876532 2222 356899999999999
Q ss_pred EEEEecCCeEEEEeCC
Q 018806 269 FFAAKFDGTFYLWETN 284 (350)
Q Consensus 269 l~~~~~d~~v~iwd~~ 284 (350)
|+...+|++|.-||..
T Consensus 368 lv~vcdd~~Vwrwdrv 383 (385)
T KOG1034|consen 368 LVLVCDDGTVWRWDRV 383 (385)
T ss_pred EEEEeCCCcEEEEEee
Confidence 9999999999999864
No 200
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=99.59 E-value=6.3e-13 Score=103.62 Aligned_cols=197 Identities=14% Similarity=0.163 Sum_probs=142.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
+|+++.+.|..+-|++++.|+.++-||+++ |+....+ .+|.+.|.++.--.....+++++.||++++||.++.++..
T Consensus 116 eINam~ldP~enSi~~AgGD~~~y~~dlE~--G~i~r~~-rGHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k~v~ 192 (325)
T KOG0649|consen 116 EINAMWLDPSENSILFAGGDGVIYQVDLED--GRIQREY-RGHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQKHVS 192 (325)
T ss_pred ccceeEeccCCCcEEEecCCeEEEEEEecC--CEEEEEE-cCCcceeeeeeecccCcceeecCCCccEEEEeccccceeE
Confidence 689999999988888888999999999965 6554544 6999999999985555789999999999999999877766
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEE
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSIL 260 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~ 260 (350)
.+.... -...++.|....|.+++-+ ..++++++.. .+.+|.+++.++..++.....+..+
T Consensus 193 ~ie~yk----------------~~~~lRp~~g~wigala~~--edWlvCGgGp--~lslwhLrsse~t~vfpipa~v~~v 252 (325)
T KOG0649|consen 193 MIEPYK----------------NPNLLRPDWGKWIGALAVN--EDWLVCGGGP--KLSLWHLRSSESTCVFPIPARVHLV 252 (325)
T ss_pred Eecccc----------------ChhhcCcccCceeEEEecc--CceEEecCCC--ceeEEeccCCCceEEEecccceeEe
Confidence 554331 1122344444566777664 5688888765 6999999999999888888899999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEE
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGS 322 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~ 322 (350)
.|-.| .++.++..+.|.-|.+..--...........++..|+-.--.+++..+.+..+-.
T Consensus 253 ~F~~d--~vl~~G~g~~v~~~~l~Gvl~a~ip~~s~~c~s~s~~~~p~k~~s~ag~s~~~~i 312 (325)
T KOG0649|consen 253 DFVDD--CVLIGGEGNHVQSYTLNGVLQANIPVESTACYSASWQTSPIKFISIAGFSNKLHI 312 (325)
T ss_pred eeecc--eEEEeccccceeeeeeccEEEEeccCCccceeeecccCCceEEEEecccceeeee
Confidence 98544 6777888888988877532223333344456666665554444444444434333
No 201
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.59 E-value=1.5e-12 Score=105.38 Aligned_cols=174 Identities=14% Similarity=0.141 Sum_probs=122.8
Q ss_pred CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC-CCCceeecccccccceecCCCCC
Q 018806 121 TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP-GNAASVRSGAASFLGALSRGPGT 199 (350)
Q Consensus 121 ~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~-~~~~~~~~~~~~~~~~~~~~~~~ 199 (350)
..+.|||= ....++..+ ....+|.++.+.++ .+++.-++.|+||.+... +....
T Consensus 75 NkviIWDD--~k~~~i~el--~f~~~I~~V~l~r~---riVvvl~~~I~VytF~~n~k~l~~------------------ 129 (346)
T KOG2111|consen 75 NKVIIWDD--LKERCIIEL--SFNSEIKAVKLRRD---RIVVVLENKIYVYTFPDNPKLLHV------------------ 129 (346)
T ss_pred ceEEEEec--ccCcEEEEE--EeccceeeEEEcCC---eEEEEecCeEEEEEcCCChhheee------------------
Confidence 46778882 223333333 35678999999876 344556788999988732 22111
Q ss_pred ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc---eeeeecCCCeEEEEEcCCCCEEEEEecCC
Q 018806 200 RWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG---TPIRRGFGGLSILKWSPTGDYFFAAKFDG 276 (350)
Q Consensus 200 ~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~---~~~~~~~~~v~~~~~sp~g~~l~~~~~d~ 276 (350)
..+... +....++.-..+...|++-+...|.|.|-|+...+. ..+..|...|.+++.+-+|..+|+++..|
T Consensus 130 ----~et~~N--PkGlC~~~~~~~k~~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkG 203 (346)
T KOG2111|consen 130 ----IETRSN--PKGLCSLCPTSNKSLLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQGTLVATASTKG 203 (346)
T ss_pred ----eecccC--CCceEeecCCCCceEEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCCccEEEEeccCc
Confidence 111221 234555554555667888777779999999987665 56778999999999999999999999998
Q ss_pred e-EEEEeCCCCceec-cc--cCCCCeEEEEEcCCCCEEEEEECCC-eEEEEEEe
Q 018806 277 T-FYLWETNTWTSEP-WS--STSGFVTGATWDPEGRMILLAFAGS-LTLGSIHF 325 (350)
Q Consensus 277 ~-v~iwd~~~~~~~~-~~--~~~~~v~~~~~s~~g~~l~~~~~~~-~~~~~~~~ 325 (350)
+ |+|||..+|+... +. .....|.+|+||||..+|++++++. ..++.++-
T Consensus 204 TLIRIFdt~~g~~l~E~RRG~d~A~iy~iaFSp~~s~LavsSdKgTlHiF~l~~ 257 (346)
T KOG2111|consen 204 TLIRIFDTEDGTLLQELRRGVDRADIYCIAFSPNSSWLAVSSDKGTLHIFSLRD 257 (346)
T ss_pred EEEEEEEcCCCcEeeeeecCCchheEEEEEeCCCccEEEEEcCCCeEEEEEeec
Confidence 5 7999999998843 33 3345799999999999999998654 55555554
No 202
>PRK04043 tolB translocation protein TolB; Provisional
Probab=99.58 E-value=1.8e-12 Score=115.47 Aligned_cols=195 Identities=14% Similarity=0.097 Sum_probs=130.1
Q ss_pred CeeEEEEecCCCE-EEEEECC---CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-C--CcEEEEec
Q 018806 101 DLQGVSWHQHKHI-VAFISGS---TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-K--GGICIWAP 173 (350)
Q Consensus 101 ~V~~v~~sp~g~~-la~~s~d---~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d--~~v~iwd~ 173 (350)
......|||||+. ++..+.+ ..|.++|+. +++..... ...+......|+|||++++.... + ..|.++|+
T Consensus 189 ~~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~--tg~~~~lt--~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~dl 264 (419)
T PRK04043 189 LNIFPKWANKEQTAFYYTSYGERKPTLYKYNLY--TGKKEKIA--SSQGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYDT 264 (419)
T ss_pred CeEeEEECCCCCcEEEEEEccCCCCEEEEEECC--CCcEEEEe--cCCCcEEeeEECCCCCEEEEEEccCCCcEEEEEEC
Confidence 5678999999985 6665544 456666664 34433332 24556677899999988877655 3 45666676
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIR 251 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~ 251 (350)
..+ .... +..+. .......|+|||+.|+..+...| .|+++|+.+++...+.
T Consensus 265 ~~g-~~~~-------------------------LT~~~-~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt 317 (419)
T PRK04043 265 NTK-TLTQ-------------------------ITNYP-GIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVV 317 (419)
T ss_pred CCC-cEEE-------------------------cccCC-CccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCc
Confidence 522 2211 11111 22345689999999988875433 6888899888765544
Q ss_pred ecCCCeEEEEEcCCCCEEEEEecC---------CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE--CCCeEE
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKFD---------GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF--AGSLTL 320 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~d---------~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~ 320 (350)
..... ...|+|||++|+..... ..|++.|+.+++...+... .......|+|||++|++.. .+...+
T Consensus 318 ~~g~~--~~~~SPDG~~Ia~~~~~~~~~~~~~~~~I~v~d~~~g~~~~LT~~-~~~~~p~~SPDG~~I~f~~~~~~~~~L 394 (419)
T PRK04043 318 FHGKN--NSSVSTYKNYIVYSSRETNNEFGKNTFNLYLISTNSDYIRRLTAN-GVNQFPRFSSDGGSIMFIKYLGNQSAL 394 (419)
T ss_pred cCCCc--CceECCCCCEEEEEEcCCCcccCCCCcEEEEEECCCCCeEECCCC-CCcCCeEECCCCCEEEEEEccCCcEEE
Confidence 32211 35899999998766543 3788999999887666654 2344689999999998876 344568
Q ss_pred EEEEeCCCC
Q 018806 321 GSIHFASKP 329 (350)
Q Consensus 321 ~~~~~~~~~ 329 (350)
+.+++....
T Consensus 395 ~~~~l~g~~ 403 (419)
T PRK04043 395 GIIRLNYNK 403 (419)
T ss_pred EEEecCCCe
Confidence 888887654
No 203
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.58 E-value=3.7e-14 Score=117.85 Aligned_cols=164 Identities=17% Similarity=0.329 Sum_probs=128.3
Q ss_pred CCCeeEEEEeeCCC-eEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC
Q 018806 144 QRDVKVLEWRPNGG-RSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP 222 (350)
Q Consensus 144 ~~~v~~~~~sp~~~-~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 222 (350)
..+|.++.|.+++. .++++|.|..|++|-+........ +.++.....+..|+ ..|+.+.|+|
T Consensus 13 ~~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~----------------~~~V~y~s~Ls~H~-~aVN~vRf~p 75 (434)
T KOG1009|consen 13 HEPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGG----------------DMKVEYLSSLSRHT-RAVNVVRFSP 75 (434)
T ss_pred CCceEEEEeccCcccceecccCccceeeeeeeecCCCCC----------------ceeEEEeecccCCc-ceeEEEEEcC
Confidence 45899999998876 788888899999999874332211 12344556677886 7999999999
Q ss_pred CCCeEEEEEeCCCeEEEEeCC--------C-----CC----ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC
Q 018806 223 DGRYLASASYESSSFTIWDVA--------Q-----GL----GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 223 ~g~~l~~~~~d~g~i~iwd~~--------~-----~~----~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~ 285 (350)
+|..|++++.+ |.|.+|-.. + .+ ...+..|...++.++|+|++.++++++.|+.+++||+..
T Consensus 76 ~gelLASg~D~-g~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~ 154 (434)
T KOG1009|consen 76 DGELLASGGDG-GEVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHA 154 (434)
T ss_pred CcCeeeecCCC-ceEEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccCCCceeeeeeccceEEEEEecc
Confidence 99999999988 799999765 2 11 112345778899999999999999999999999999999
Q ss_pred Ccee-ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 286 WTSE-PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 286 ~~~~-~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
|... .+..|...+..++|.|-++++++=+ +...+.+.+..
T Consensus 155 G~l~~~~~dh~~yvqgvawDpl~qyv~s~s~dr~~~~~~~~~ 196 (434)
T KOG1009|consen 155 GQLLAILDDHEHYVQGVAWDPLNQYVASKSSDRHPEGFSAKL 196 (434)
T ss_pred ceeEeeccccccccceeecchhhhhhhhhccCcccceeeeee
Confidence 9985 4668999999999999999998765 44344444433
No 204
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=99.57 E-value=6.6e-14 Score=120.40 Aligned_cols=174 Identities=13% Similarity=0.224 Sum_probs=129.1
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..+.+-.|+|||.-|++++.||.|++|.-. |.....+ .....+|.|++|.|+.+.++++..+ .+.|=-+.....
T Consensus 105 ~A~~~gRW~~dGtgLlt~GEDG~iKiWSrs---GMLRStl-~Q~~~~v~c~~W~p~S~~vl~c~g~-h~~IKpL~~n~k- 178 (737)
T KOG1524|consen 105 AAISSGRWSPDGAGLLTAGEDGVIKIWSRS---GMLRSTV-VQNEESIRCARWAPNSNSIVFCQGG-HISIKPLAANSK- 178 (737)
T ss_pred hhhhhcccCCCCceeeeecCCceEEEEecc---chHHHHH-hhcCceeEEEEECCCCCceEEecCC-eEEEeecccccc-
Confidence 457888999999999999999999999953 4433333 3466789999999998888776654 344433331111
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSI 259 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~ 259 (350)
.-..+.| ++-|.++.|++....+++++.|- ..++||........-..|..+|++
T Consensus 179 ------------------------~i~WkAH-DGiiL~~~W~~~s~lI~sgGED~-kfKvWD~~G~~Lf~S~~~ey~ITS 232 (737)
T KOG1524|consen 179 ------------------------IIRWRAH-DGLVLSLSWSTQSNIIASGGEDF-RFKIWDAQGANLFTSAAEEYAITS 232 (737)
T ss_pred ------------------------eeEEecc-CcEEEEeecCccccceeecCCce-eEEeecccCcccccCChhccceee
Confidence 1113455 48999999999999999999994 999999876655555668899999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
++|+|+ +.++.++. +++++ .....+.|..++||+||.++++|+...
T Consensus 233 va~npd-~~~~v~S~-nt~R~----------~~p~~GSifnlsWS~DGTQ~a~gt~~G 278 (737)
T KOG1524|consen 233 VAFNPE-KDYLLWSY-NTARF----------SSPRVGSIFNLSWSADGTQATCGTSTG 278 (737)
T ss_pred eeeccc-cceeeeee-eeeee----------cCCCccceEEEEEcCCCceeeccccCc
Confidence 999999 66666653 33441 112346899999999999999887544
No 205
>PRK01029 tolB translocation protein TolB; Provisional
Probab=99.57 E-value=5.4e-13 Score=119.57 Aligned_cols=183 Identities=17% Similarity=0.192 Sum_probs=121.6
Q ss_pred eeEEEEecCCCEEEEEEC-CC--eE--EEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCC
Q 018806 102 LQGVSWHQHKHIVAFISG-ST--QV--IVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSY 175 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~-d~--~i--~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~ 175 (350)
....+|||||++||..+. +| .+ .+|++..........++..........+|+|||+.+++.+. ++...+|.+..
T Consensus 233 ~~~p~wSPDG~~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~ 312 (428)
T PRK01029 233 QLMPTFSPRKKLLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQI 312 (428)
T ss_pred ccceEECCCCCEEEEEECCCCCcceeEEEeecccCCCCcceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEEC
Confidence 456799999999998663 22 23 34565432122233343333344577899999998888775 56656665432
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeec
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRG 253 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~ 253 (350)
...... ...+..+. ..+....|||||+.|+..+.++| .|.+||+.+++...+...
T Consensus 313 ~~~g~~----------------------~~~lt~~~-~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g~~~~Lt~~ 369 (428)
T PRK01029 313 DPEGQS----------------------PRLLTKKY-RNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATGRDYQLTTS 369 (428)
T ss_pred cccccc----------------------eEEeccCC-CCccceeECCCCCEEEEEEcCCCCcEEEEEECCCCCeEEccCC
Confidence 110000 01122222 35678899999999998765432 799999999987766555
Q ss_pred CCCeEEEEEcCCCCEEEEEec---CCeEEEEeCCCCceeccccCCCCeEEEEEcCCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKF---DGTFYLWETNTWTSEPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g 307 (350)
...+....|+|||+.|+.... ...|+++|+.+++...+....+.+...+|+|-.
T Consensus 370 ~~~~~~p~wSpDG~~L~f~~~~~g~~~L~~vdl~~g~~~~Lt~~~g~~~~p~Ws~~~ 426 (428)
T PRK01029 370 PENKESPSWAIDSLHLVYSAGNSNESELYLISLITKKTRKIVIGSGEKRFPSWGAFP 426 (428)
T ss_pred CCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEeecCCCcccCceecCCC
Confidence 556778999999998875543 357999999998887776666667888999854
No 206
>PRK00178 tolB translocation protein TolB; Provisional
Probab=99.56 E-value=2.1e-12 Score=116.80 Aligned_cols=175 Identities=16% Similarity=0.236 Sum_probs=118.5
Q ss_pred EEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCCCCCceeecccccccceecCCCCC
Q 018806 123 VIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYPGNAASVRSGAASFLGALSRGPGT 199 (350)
Q Consensus 123 i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~ 199 (350)
|.++|.+ +.....+. .+...+...+|+|||+++++.+.+ ..|.+|++..+. ...+
T Consensus 181 l~~~d~~---g~~~~~l~-~~~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~-~~~l----------------- 238 (430)
T PRK00178 181 LQRSDYD---GARAVTLL-QSREPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGR-REQI----------------- 238 (430)
T ss_pred EEEECCC---CCCceEEe-cCCCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCC-EEEc-----------------
Confidence 5566654 33334443 456789999999999999887754 468888886332 1111
Q ss_pred ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec-C-
Q 018806 200 RWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF-D- 275 (350)
Q Consensus 200 ~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d- 275 (350)
... .+.+...+|+|||+.|+.....+| .|++||+.+++...+..+........|+|||+.|+..+. +
T Consensus 239 --------~~~-~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d~~~~~~~~lt~~~~~~~~~~~spDg~~i~f~s~~~g 309 (430)
T PRK00178 239 --------TNF-EGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMDLASRQLSRVTNHPAIDTEPFWGKDGRTLYFTSDRGG 309 (430)
T ss_pred --------cCC-CCCcCCeEECCCCCEEEEEEccCCCceEEEEECCCCCeEEcccCCCCcCCeEECCCCCEEEEEECCCC
Confidence 111 134557899999999886543324 688899998877666555556677899999998876654 3
Q ss_pred -CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCCC
Q 018806 276 -GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFASK 328 (350)
Q Consensus 276 -~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~~ 328 (350)
..|+++|+.+++...+..........+|+|||++|++... +...++.+++...
T Consensus 310 ~~~iy~~d~~~g~~~~lt~~~~~~~~~~~Spdg~~i~~~~~~~~~~~l~~~dl~tg 365 (430)
T PRK00178 310 KPQIYKVNVNGGRAERVTFVGNYNARPRLSADGKTLVMVHRQDGNFHVAAQDLQRG 365 (430)
T ss_pred CceEEEEECCCCCEEEeecCCCCccceEECCCCCEEEEEEccCCceEEEEEECCCC
Confidence 3688889988887655433334456789999999998863 2245666666543
No 207
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.56 E-value=7e-14 Score=121.65 Aligned_cols=191 Identities=17% Similarity=0.252 Sum_probs=143.8
Q ss_pred cCeeEEEEecCCCEEEEEEC---CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISG---STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~---d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
..|+.+.||..|.||++... ...|.|..+.....+ .-+....+.|.++.|+|. ...+.+++...|+|||+...
T Consensus 522 k~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ---~PF~kskG~vq~v~FHPs-~p~lfVaTq~~vRiYdL~kq 597 (733)
T KOG0650|consen 522 KSIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQ---SPFRKSKGLVQRVKFHPS-KPYLFVATQRSVRIYDLSKQ 597 (733)
T ss_pred CccceeeeecCCceEEEeccCCCcceEEEEeccccccc---CchhhcCCceeEEEecCC-CceEEEEeccceEEEehhHH
Confidence 47999999999999999754 356778888532222 222235678999999999 56666677789999999854
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC--ceeeeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL--GTPIRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~--~~~~~~~~ 254 (350)
...+.+.++ . ..|.+++.+|.|..|+.++.|+ .+..+|+.-.. ...+..|.
T Consensus 598 elvKkL~tg-------------------------~-kwiS~msihp~GDnli~gs~d~-k~~WfDldlsskPyk~lr~H~ 650 (733)
T KOG0650|consen 598 ELVKKLLTG-------------------------S-KWISSMSIHPNGDNLILGSYDK-KMCWFDLDLSSKPYKTLRLHE 650 (733)
T ss_pred HHHHHHhcC-------------------------C-eeeeeeeecCCCCeEEEecCCC-eeEEEEcccCcchhHHhhhhh
Confidence 444443333 2 5899999999999999999994 99999988653 34566788
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCC-------CCce---eccccCCCC----eEEEEEcCCCCEEEEEE-CCCeE
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETN-------TWTS---EPWSSTSGF----VTGATWDPEGRMILLAF-AGSLT 319 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~-------~~~~---~~~~~~~~~----v~~~~~s~~g~~l~~~~-~~~~~ 319 (350)
..+++++|++.-.++++|+.||++.|+.-. +.-+ ..+.+|... |..+.|+|...+|++++ ++.+.
T Consensus 651 ~avr~Va~H~ryPLfas~sdDgtv~Vfhg~VY~Dl~qnpliVPlK~L~gH~~~~~~gVLd~~wHP~qpWLfsAGAd~tir 730 (733)
T KOG0650|consen 651 KAVRSVAFHKRYPLFASGSDDGTVIVFHGMVYNDLLQNPLIVPLKRLRGHEKTNDLGVLDTIWHPRQPWLFSAGADGTIR 730 (733)
T ss_pred hhhhhhhhccccceeeeecCCCcEEEEeeeeehhhhcCCceEeeeeccCceeecccceEeecccCCCceEEecCCCceEE
Confidence 999999999999999999999999998432 1112 335566544 88999999999999886 44444
Q ss_pred EE
Q 018806 320 LG 321 (350)
Q Consensus 320 ~~ 321 (350)
+|
T Consensus 731 lf 732 (733)
T KOG0650|consen 731 LF 732 (733)
T ss_pred ee
Confidence 43
No 208
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=99.56 E-value=1.5e-12 Score=117.59 Aligned_cols=176 Identities=19% Similarity=0.334 Sum_probs=122.9
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCCCCCceeecccccccceecCCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYPGNAASVRSGAASFLGALSRGPG 198 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~ 198 (350)
.|.++|.+ +.....+. .+...+...+|+|||++++++..+ ..|++||+..+.. ..
T Consensus 171 ~l~~~d~~---g~~~~~l~-~~~~~~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~-~~----------------- 228 (417)
T TIGR02800 171 ELQVADYD---GANPQTIT-RSREPILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQR-EK----------------- 228 (417)
T ss_pred eEEEEcCC---CCCCEEee-cCCCceecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCE-EE-----------------
Confidence 46666664 33334443 456678999999999998887654 4789999874321 11
Q ss_pred CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC-
Q 018806 199 TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD- 275 (350)
Q Consensus 199 ~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d- 275 (350)
+..+. +.+.+++|+|||+.|++....+| .|++||+.++....+..+........|+|||++|+..+..
T Consensus 229 --------~~~~~-~~~~~~~~spDg~~l~~~~~~~~~~~i~~~d~~~~~~~~l~~~~~~~~~~~~s~dg~~l~~~s~~~ 299 (417)
T TIGR02800 229 --------VASFP-GMNGAPAFSPDGSKLAVSLSKDGNPDIYVMDLDGKQLTRLTNGPGIDTEPSWSPDGKSIAFTSDRG 299 (417)
T ss_pred --------eecCC-CCccceEECCCCCEEEEEECCCCCccEEEEECCCCCEEECCCCCCCCCCEEECCCCCEEEEEECCC
Confidence 11111 35567899999998876543222 6999999988766665555555678999999998776543
Q ss_pred C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECC--CeEEEEEEeCCC
Q 018806 276 G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAG--SLTLGSIHFASK 328 (350)
Q Consensus 276 ~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~--~~~~~~~~~~~~ 328 (350)
+ .|+++|+.+++...+..+...+..++|+|+|++|+++... ...++.+++...
T Consensus 300 g~~~iy~~d~~~~~~~~l~~~~~~~~~~~~spdg~~i~~~~~~~~~~~i~~~d~~~~ 356 (417)
T TIGR02800 300 GSPQIYMMDADGGEVRRLTFRGGYNASPSWSPDGDLIAFVHREGGGFNIAVMDLDGG 356 (417)
T ss_pred CCceEEEEECCCCCEEEeecCCCCccCeEECCCCCEEEEEEccCCceEEEEEeCCCC
Confidence 2 6888999888776666566677889999999999988733 346777776543
No 209
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.55 E-value=5.4e-13 Score=121.08 Aligned_cols=227 Identities=15% Similarity=0.215 Sum_probs=143.6
Q ss_pred CCCccCeeEEEEecCCCEEEEEECCCeEEEEEccC-CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 96 LLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYED-SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 96 ~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~-~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
+.+...+++.++||+++++|++..||.|.+|.-.. ......+...+=|...|.+++|+++|..++++|..+.+-+|.+.
T Consensus 202 ~~Htf~~t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~lHWH~~~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~ 281 (792)
T KOG1963|consen 202 VHHTFNITCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTLLHWHHDEVNSLSFSSDGAYLLSGGREGVLVLWQLE 281 (792)
T ss_pred hhhcccceeEEeccccceEEEeccCCcEEEEeccccccccccceEEEecccccceeEEecCCceEeecccceEEEEEeec
Confidence 33455789999999999999999999999997432 22334445545688899999999999999999999999999998
Q ss_pred CCCCCceeecccccccceecCCCCCceE----------Eee--------eccC----------CCCCceeeEEECCCCCe
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWT----------LVD--------FLRS----------QNGEQITALSWGPDGRY 226 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~----------~~~--------~~~~----------~~~~~v~~~~~sp~g~~ 226 (350)
+++ +++.+.-.+++..+..++++... ++. ++.+ ...+-.+.++++|.-+.
T Consensus 282 T~~--kqfLPRLgs~I~~i~vS~ds~~~sl~~~DNqI~li~~~dl~~k~tIsgi~~~~~~~k~~~~~l~t~~~idpr~~~ 359 (792)
T KOG1963|consen 282 TGK--KQFLPRLGSPILHIVVSPDSDLYSLVLEDNQIHLIKASDLEIKSTISGIKPPTPSTKTRPQSLTTGVSIDPRTNS 359 (792)
T ss_pred CCC--cccccccCCeeEEEEEcCCCCeEEEEecCceEEEEeccchhhhhhccCccCCCccccccccccceeEEEcCCCCc
Confidence 665 44444444455555555544322 111 0000 01122344555554444
Q ss_pred EEEEEeCCCeEEEEeCCCC-------------------------------------------------------------
Q 018806 227 LASASYESSSFTIWDVAQG------------------------------------------------------------- 245 (350)
Q Consensus 227 l~~~~~d~g~i~iwd~~~~------------------------------------------------------------- 245 (350)
++..+.. |.|.+||+.+.
T Consensus 360 ~vln~~~-g~vQ~ydl~td~~i~~~~v~~~n~~~~~~n~~v~itav~~~~~gs~maT~E~~~d~~~~~~~e~~LKFW~~n 438 (792)
T KOG1963|consen 360 LVLNGHP-GHVQFYDLYTDSTIYKLQVCDENYSDGDVNIQVGITAVARSRFGSWMATLEARIDKFNFFDGEVSLKFWQYN 438 (792)
T ss_pred eeecCCC-ceEEEEeccccceeeeEEEEeecccCCcceeEEeeeeehhhccceEEEEeeeeehhhhccCceEEEEEEEEc
Confidence 4444444 45555554322
Q ss_pred --Ccee------eeecCCCeEEEEE-cCCCC-EEEEEecCCeEEEEeCCCCce----------ec-cccCCCCeEEEEEc
Q 018806 246 --LGTP------IRRGFGGLSILKW-SPTGD-YFFAAKFDGTFYLWETNTWTS----------EP-WSSTSGFVTGATWD 304 (350)
Q Consensus 246 --~~~~------~~~~~~~v~~~~~-sp~g~-~l~~~~~d~~v~iwd~~~~~~----------~~-~~~~~~~v~~~~~s 304 (350)
.... ...|...+...++ ++... ..++++.||.++||-+...+. .. -..|..++++++|+
T Consensus 439 ~~~kt~~L~T~I~~PH~~~~vat~~~~~~rs~~~vta~~dg~~KiW~~~~~~n~~k~~s~W~c~~i~sy~k~~i~a~~fs 518 (792)
T KOG1963|consen 439 PNSKTFILNTKINNPHGNAFVATIFLNPTRSVRCVTASVDGDFKIWVFTDDSNIYKKSSNWTCKAIGSYHKTPITALCFS 518 (792)
T ss_pred CCcceeEEEEEEecCCCceeEEEEEecCcccceeEEeccCCeEEEEEEecccccCcCccceEEeeeeccccCcccchhhc
Confidence 1111 1123333333333 33333 678899999999998843322 10 11467889999999
Q ss_pred CCCCEEEEEECCCeEEEEEEe
Q 018806 305 PEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 305 ~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.||..|+++.++.+.+|..+-
T Consensus 519 ~dGslla~s~~~~Itiwd~~~ 539 (792)
T KOG1963|consen 519 QDGSLLAVSFDDTITIWDYDT 539 (792)
T ss_pred CCCcEEEEecCCEEEEecCCC
Confidence 999999988888777776655
No 210
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.55 E-value=2.5e-13 Score=112.71 Aligned_cols=188 Identities=9% Similarity=0.089 Sum_probs=133.8
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccC----CCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYED----SEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~----~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
-|.++.||.++++||+|+.|..+++|+++. ...+.+......|...|.+++|......+++++.+++|...|+++.
T Consensus 58 CiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI~HDiEt~ 137 (609)
T KOG4227|consen 58 CINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVIKHDIETK 137 (609)
T ss_pred ccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeEeeecccc
Confidence 499999999999999999999999999863 1223334443457789999999887666666677899999999854
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-cee---eee
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL-GTP---IRR 252 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~-~~~---~~~ 252 (350)
+.+..+.. ....+.|+.+..+|-...|++.+.+ |.|.+||.+..+ ... ...
T Consensus 138 qsi~V~~~------------------------~~~~~~VY~m~~~P~DN~~~~~t~~-~~V~~~D~Rd~~~~~~~~~~AN 192 (609)
T KOG4227|consen 138 QSIYVANE------------------------NNNRGDVYHMDQHPTDNTLIVVTRA-KLVSFIDNRDRQNPISLVLPAN 192 (609)
T ss_pred eeeeeecc------------------------cCcccceeecccCCCCceEEEEecC-ceEEEEeccCCCCCCceeeecC
Confidence 43222111 1123689999999998899999888 699999998765 221 222
Q ss_pred cCCCeEEEEEcCCCC-EEEEEecCCeEEEEeCCCCceec--------cccCCCCeEEEEEcCCCCEEEEE
Q 018806 253 GFGGLSILKWSPTGD-YFFAAKFDGTFYLWETNTWTSEP--------WSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~-~l~~~~~d~~v~iwd~~~~~~~~--------~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
.......+.|+|... +|++.+..+-+-+||.+...... +......-.++.|+|+|.++++-
T Consensus 193 ~~~~F~t~~F~P~~P~Li~~~~~~~G~~~~D~R~~~~~~~~~~~~~~L~~~~~~~M~~~~~~~G~Q~msi 262 (609)
T KOG4227|consen 193 SGKNFYTAEFHPETPALILVNSETGGPNVFDRRMQARPVYQRSMFKGLPQENTEWMGSLWSPSGNQFMSI 262 (609)
T ss_pred CCccceeeeecCCCceeEEeccccCCCCceeeccccchHHhhhccccCcccchhhhheeeCCCCCeehhh
Confidence 346688899999754 56788888889999998755311 11212222456788887776543
No 211
>PRK04792 tolB translocation protein TolB; Provisional
Probab=99.54 E-value=2.3e-12 Score=116.39 Aligned_cols=176 Identities=19% Similarity=0.278 Sum_probs=118.3
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCCCCCceeecccccccceecCCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYPGNAASVRSGAASFLGALSRGPG 198 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~ 198 (350)
.+.++|.+ +.....+. .+...+.+..|+|||++++++..+ ..|++||+..+. ...+..
T Consensus 199 ~l~i~d~d---G~~~~~l~-~~~~~~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~-~~~lt~-------------- 259 (448)
T PRK04792 199 QLMIADYD---GYNEQMLL-RSPEPLMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQV-REKVTS-------------- 259 (448)
T ss_pred EEEEEeCC---CCCceEee-cCCCcccCceECCCCCEEEEEEecCCCcEEEEEECCCCC-eEEecC--------------
Confidence 55566764 33233333 456789999999999998887653 357777876322 111111
Q ss_pred CceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec-C
Q 018806 199 TRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF-D 275 (350)
Q Consensus 199 ~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d 275 (350)
+. +.....+|+|||+.|+.....+| .|+++|+.+++...+..+.......+|+|||++|+..+. +
T Consensus 260 --------~~----g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~tg~~~~lt~~~~~~~~p~wSpDG~~I~f~s~~~ 327 (448)
T PRK04792 260 --------FP----GINGAPRFSPDGKKLALVLSKDGQPEIYVVDIATKALTRITRHRAIDTEPSWHPDGKSLIFTSERG 327 (448)
T ss_pred --------CC----CCcCCeeECCCCCEEEEEEeCCCCeEEEEEECCCCCeEECccCCCCccceEECCCCCEEEEEECCC
Confidence 11 23457899999999987644335 488889988877666655556678999999999876654 3
Q ss_pred C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC--CCeEEEEEEeCCC
Q 018806 276 G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA--GSLTLGSIHFASK 328 (350)
Q Consensus 276 ~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~--~~~~~~~~~~~~~ 328 (350)
+ .|+++|+.+++...+..........+|+|||++|++... +...++.+++...
T Consensus 328 g~~~Iy~~dl~~g~~~~Lt~~g~~~~~~~~SpDG~~l~~~~~~~g~~~I~~~dl~~g 384 (448)
T PRK04792 328 GKPQIYRVNLASGKVSRLTFEGEQNLGGSITPDGRSMIMVNRTNGKFNIARQDLETG 384 (448)
T ss_pred CCceEEEEECCCCCEEEEecCCCCCcCeeECCCCCEEEEEEecCCceEEEEEECCCC
Confidence 3 677888888887655433334456799999999988763 3346777776544
No 212
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=99.54 E-value=4.9e-13 Score=108.15 Aligned_cols=191 Identities=14% Similarity=0.227 Sum_probs=138.4
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEc-cCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDY-EDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~-~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
...|++|.|+|..+.|++++.|..-++|.. +..+-+....+ ..++..++++.|+|..+++++++..+.|.||-++.+.
T Consensus 55 d~~vtgvdWap~snrIvtcs~drnayVw~~~~~~~WkptlvL-lRiNrAAt~V~WsP~enkFAVgSgar~isVcy~E~EN 133 (361)
T KOG1523|consen 55 DKIVTGVDWAPKSNRIVTCSHDRNAYVWTQPSGGTWKPTLVL-LRINRAATCVKWSPKENKFAVGSGARLISVCYYEQEN 133 (361)
T ss_pred CcceeEEeecCCCCceeEccCCCCccccccCCCCeeccceeE-EEeccceeeEeecCcCceEEeccCccEEEEEEEeccc
Confidence 446999999999999999999999999998 33333333333 3688999999999998888888888999999988332
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC-----CC-------
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA-----QG------- 245 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~-----~~------- 245 (350)
.|-+.+.++....+.|.++.|+|++-.|++++.| +.++++..- ..
T Consensus 134 ----------------------dWWVsKhikkPirStv~sldWhpnnVLlaaGs~D-~k~rVfSayIK~Vdekpap~pWg 190 (361)
T KOG1523|consen 134 ----------------------DWWVSKHIKKPIRSTVTSLDWHPNNVLLAAGSTD-GKCRVFSAYIKGVDEKPAPTPWG 190 (361)
T ss_pred ----------------------ceehhhhhCCccccceeeeeccCCcceecccccC-cceeEEEEeeeccccCCCCCCCc
Confidence 2222222333334789999999999999999999 799998642 11
Q ss_pred Cce----eee---ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEE
Q 018806 246 LGT----PIR---RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 246 ~~~----~~~---~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
... .+. ...+.+..+.|+|+|..|+-.+.|..+.+-|...... .......-+..++.|-.+...++++
T Consensus 191 sk~PFG~lm~E~~~~ggwvh~v~fs~sG~~lawv~Hds~v~~~da~~p~~~v~~~~~~~lP~ls~~~ise~~vv~ag 267 (361)
T KOG1523|consen 191 SKMPFGQLMSEASSSGGWVHGVLFSPSGNRLAWVGHDSTVSFVDAAGPSERVQSVATAQLPLLSVSWISENSVVAAG 267 (361)
T ss_pred cCCcHHHHHHhhccCCCceeeeEeCCCCCEeeEecCCCceEEeecCCCchhccchhhccCCceeeEeecCCceeecC
Confidence 111 111 2347799999999999999999999999999877652 2233333566677776554444433
No 213
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.53 E-value=2.9e-12 Score=115.64 Aligned_cols=214 Identities=14% Similarity=0.163 Sum_probs=143.9
Q ss_pred ccCeeEEEEecC-CCEEEEEECCCeEEEEEccCCCCC---ceeEecCCCCCCeeEEEEeeCCCe--EEEEecCCcEEEEe
Q 018806 99 EVDLQGVSWHQH-KHIVAFISGSTQVIVRDYEDSEGK---DACILTSDSQRDVKVLEWRPNGGR--SLSVGCKGGICIWA 172 (350)
Q Consensus 99 ~~~V~~v~~sp~-g~~la~~s~d~~i~iw~~~~~~~~---~~~~~~~~~~~~v~~~~~sp~~~~--l~~~~~d~~v~iwd 172 (350)
...|+++.|+|. ..+||.|..+|.|.+||+...... ........|..++..+.|..+-.. +++++.||.|+.|+
T Consensus 242 ~s~v~~~~f~p~~p~ll~gG~y~GqV~lWD~~~~~~~~~s~ls~~~~sh~~~v~~vvW~~~~~~~~f~s~ssDG~i~~W~ 321 (555)
T KOG1587|consen 242 PSEVTCLKFCPFDPNLLAGGCYNGQVVLWDLRKGSDTPPSGLSALEVSHSEPVTAVVWLQNEHNTEFFSLSSDGSICSWD 321 (555)
T ss_pred CCceeEEEeccCCcceEEeeccCceEEEEEccCCCCCCCcccccccccCCcCeEEEEEeccCCCCceEEEecCCcEeeee
Confidence 347999999994 578888889999999999643321 122333468999999999766444 99999999999998
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCC---CC--
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQ---GL-- 246 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~---~~-- 246 (350)
++.-..+......... ........ ....+++++|.+. -..++.|+.+ |.|.--+... ..
T Consensus 322 ~~~l~~P~e~~~~~~~------------~~~~~~~~--~~~~~t~~~F~~~~p~~FiVGTe~-G~v~~~~r~g~~~~~~~ 386 (555)
T KOG1587|consen 322 TDMLSLPVEGLLLESK------------KHKGQQSS--KAVGATSLKFEPTDPNHFIVGTEE-GKVYKGCRKGYTPAPEV 386 (555)
T ss_pred ccccccchhhcccccc------------cccccccc--cccceeeEeeccCCCceEEEEcCC-cEEEEEeccCCcccccc
Confidence 8743332221111000 00000111 1247889999884 4567777777 7887733332 22
Q ss_pred ----ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCC-CCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 247 ----GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETN-TWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 247 ----~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~-~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
......|.++|..+.++|=+..++..+.|-+++||... .... ..+..+...+++++|||-...++++.+.++.+
T Consensus 387 ~~~~~~~~~~h~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~l 466 (555)
T KOG1587|consen 387 SYKGHSTFITHIGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGNL 466 (555)
T ss_pred cccccccccccCcceEeeecCCCccceeeeeccceeEeccccCCCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCce
Confidence 11234577899999999987766555559999999887 3333 34556667799999999988888887766666
Q ss_pred EEEEeCC
Q 018806 321 GSIHFAS 327 (350)
Q Consensus 321 ~~~~~~~ 327 (350)
..|++..
T Consensus 467 ~iWDLl~ 473 (555)
T KOG1587|consen 467 DIWDLLQ 473 (555)
T ss_pred ehhhhhc
Confidence 6666643
No 214
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.52 E-value=3.5e-13 Score=109.46 Aligned_cols=179 Identities=17% Similarity=0.286 Sum_probs=122.0
Q ss_pred EEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCceee
Q 018806 105 VSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAASVR 183 (350)
Q Consensus 105 v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~~~ 183 (350)
.+|||+|++||+++.- .+.|-|.++ -+... ++. --..|.-+.|..|..+++.+.. ++.|.+|++...+-...+.
T Consensus 14 c~fSp~g~yiAs~~~y-rlviRd~~t--lq~~q-lf~-cldki~yieW~ads~~ilC~~yk~~~vqvwsl~Qpew~ckId 88 (447)
T KOG4497|consen 14 CSFSPCGNYIASLSRY-RLVIRDSET--LQLHQ-LFL-CLDKIVYIEWKADSCHILCVAYKDPKVQVWSLVQPEWYCKID 88 (447)
T ss_pred eeECCCCCeeeeeeee-EEEEeccch--hhHHH-HHH-HHHHhhheeeeccceeeeeeeeccceEEEEEeecceeEEEec
Confidence 6899999999998766 566777643 22211 111 1246788999999777777776 5899999998555444433
Q ss_pred cccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEc
Q 018806 184 SGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWS 263 (350)
Q Consensus 184 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~s 263 (350)
.+ ...+.++.|||||++|+..+.-+-.|.+|.+.+.+...+...+..+..++|+
T Consensus 89 eg--------------------------~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~~~~pK~~~kg~~f~ 142 (447)
T KOG4497|consen 89 EG--------------------------QAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYLLPHPKTNVKGYAFH 142 (447)
T ss_pred cC--------------------------CCcceeeeECCCcceEeeeecceeEEEEEEeccceeEEecccccCceeEEEC
Confidence 33 3689999999999887655543259999999988777666666778889999
Q ss_pred CCCCEEEEEec-C-----------------------------------CeEEEEeCCCCceeccccCCCCeEEEEEcCCC
Q 018806 264 PTGDYFFAAKF-D-----------------------------------GTFYLWETNTWTSEPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 264 p~g~~l~~~~~-d-----------------------------------~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g 307 (350)
|||++.+..+. | ..+.+||.--........-.-.+..++|+|.+
T Consensus 143 ~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~~Leykv~aYe~~lG~k~v~wsP~~ 222 (447)
T KOG4497|consen 143 PDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDNVLEYKVYAYERGLGLKFVEWSPCN 222 (447)
T ss_pred CCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecchhhheeeeeeeccceeEEEecccc
Confidence 99998876543 1 12333332111010011123467889999999
Q ss_pred CEEEEEE
Q 018806 308 RMILLAF 314 (350)
Q Consensus 308 ~~l~~~~ 314 (350)
++|++|+
T Consensus 223 qflavGs 229 (447)
T KOG4497|consen 223 QFLAVGS 229 (447)
T ss_pred ceEEeec
Confidence 9999996
No 215
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.52 E-value=1.8e-13 Score=114.44 Aligned_cols=173 Identities=17% Similarity=0.235 Sum_probs=123.4
Q ss_pred eEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeE
Q 018806 148 KVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYL 227 (350)
Q Consensus 148 ~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l 227 (350)
..++|+.+|..+.+++.||++|||+.+..... .....|+ +.|.++.|+|||+.|
T Consensus 148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~-------------------------l~e~~~~-~eV~DL~FS~dgk~l 201 (398)
T KOG0771|consen 148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTI-------------------------LEEIAHH-AEVKDLDFSPDGKFL 201 (398)
T ss_pred eEEEEcCCCCEeeeccccceEEEEecCcchhh-------------------------hhhHhhc-CccccceeCCCCcEE
Confidence 78999999999999999999999997632221 1233454 799999999999999
Q ss_pred EEEEeCCCeEEEEeCCCCCceeeee---cCCCeEEEEEcCCC---CEE--EEEecCCeEEEEeCCCCce------ecccc
Q 018806 228 ASASYESSSFTIWDVAQGLGTPIRR---GFGGLSILKWSPTG---DYF--FAAKFDGTFYLWETNTWTS------EPWSS 293 (350)
Q Consensus 228 ~~~~~d~g~i~iwd~~~~~~~~~~~---~~~~v~~~~~sp~g---~~l--~~~~~d~~v~iwd~~~~~~------~~~~~ 293 (350)
++.+.+ ..++|+.+++....... .+.-...+.|+.|+ .+. +.....+.|..|++...+. .+...
T Consensus 202 asig~d--~~~VW~~~~g~~~a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~ 279 (398)
T KOG0771|consen 202 ASIGAD--SARVWSVNTGAALARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIK 279 (398)
T ss_pred EEecCC--ceEEEEeccCchhhhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhh
Confidence 999988 69999999995544332 23346678898876 322 3333455677776654332 22233
Q ss_pred CCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCC-CCceeecccccceeeccc
Q 018806 294 TSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPP-SLDAHLLPVDLPDIVSLT 348 (350)
Q Consensus 294 ~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~-~~~~~~~~v~~~~~~~~~ 348 (350)
....|++++.|+||++++.|+ ++++.++...--+... ...+|..-|+..++.+-+
T Consensus 280 ~~~siSsl~VS~dGkf~AlGT~dGsVai~~~~~lq~~~~vk~aH~~~VT~ltF~Pds 336 (398)
T KOG0771|consen 280 RFKSISSLAVSDDGKFLALGTMDGSVAIYDAKSLQRLQYVKEAHLGFVTGLTFSPDS 336 (398)
T ss_pred ccCcceeEEEcCCCcEEEEeccCCcEEEEEeceeeeeEeehhhheeeeeeEEEcCCc
Confidence 455799999999999999998 7777776665443322 456888888877776543
No 216
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.52 E-value=7e-11 Score=103.41 Aligned_cols=208 Identities=16% Similarity=0.227 Sum_probs=137.8
Q ss_pred ccCeeEEEEecCCCEEEEEEC-CCeEEEEEccCCCCCceeE--ec----------CCCCCCeeEEEEeeCCCeEEEEecC
Q 018806 99 EVDLQGVSWHQHKHIVAFISG-STQVIVRDYEDSEGKDACI--LT----------SDSQRDVKVLEWRPNGGRSLSVGCK 165 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~-d~~i~iw~~~~~~~~~~~~--~~----------~~~~~~v~~~~~sp~~~~l~~~~~d 165 (350)
+.....++++|++++|+++.. +|.+.+++++.. +..... .. ........++.|+|+|+.+++....
T Consensus 86 g~~p~~i~~~~~g~~l~vany~~g~v~v~~l~~~-g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG 164 (345)
T PF10282_consen 86 GSSPCHIAVDPDGRFLYVANYGGGSVSVFPLDDD-GSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLG 164 (345)
T ss_dssp SSCEEEEEECTTSSEEEEEETTTTEEEEEEECTT-SEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETT
T ss_pred CCCcEEEEEecCCCEEEEEEccCCeEEEEEccCC-cccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecC
Confidence 334567999999999999875 899999999743 322221 11 0123457899999998888776653
Q ss_pred -CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC-
Q 018806 166 -GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA- 243 (350)
Q Consensus 166 -~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~- 243 (350)
..|.+|++....... .....+..........++|+|++++++.....+++|.++++.
T Consensus 165 ~D~v~~~~~~~~~~~l---------------------~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~ 223 (345)
T PF10282_consen 165 ADRVYVYDIDDDTGKL---------------------TPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDP 223 (345)
T ss_dssp TTEEEEEEE-TTS-TE---------------------EEEEEEECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEET
T ss_pred CCEEEEEEEeCCCceE---------------------EEeeccccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecc
Confidence 889999997443211 111122222345789999999999998888766799999988
Q ss_pred -CCCceeee--e-------cCCCeEEEEEcCCCCEEEEEe-cCCeEEEEeCC--CCceec---cccCCCCeEEEEEcCCC
Q 018806 244 -QGLGTPIR--R-------GFGGLSILKWSPTGDYFFAAK-FDGTFYLWETN--TWTSEP---WSSTSGFVTGATWDPEG 307 (350)
Q Consensus 244 -~~~~~~~~--~-------~~~~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~--~~~~~~---~~~~~~~v~~~~~s~~g 307 (350)
.+....+. . .......++++|||++|+++. .++.|.+|+++ +++... +.........++++|+|
T Consensus 224 ~~g~~~~~~~~~~~~~~~~~~~~~~~i~ispdg~~lyvsnr~~~sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~s~~g 303 (345)
T PF10282_consen 224 SDGSLTEIQTISTLPEGFTGENAPAEIAISPDGRFLYVSNRGSNSISVFDLDPATGTLTLVQTVPTGGKFPRHFAFSPDG 303 (345)
T ss_dssp TTTEEEEEEEEESCETTSCSSSSEEEEEE-TTSSEEEEEECTTTEEEEEEECTTTTTEEEEEEEEESSSSEEEEEE-TTS
T ss_pred cCCceeEEEEeeeccccccccCCceeEEEecCCCEEEEEeccCCEEEEEEEecCCCceEEEEEEeCCCCCccEEEEeCCC
Confidence 44322211 1 112577899999999997765 46789999983 355432 22334558999999999
Q ss_pred CEEEEEECCCeEEEEEEeCCC
Q 018806 308 RMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 308 ~~l~~~~~~~~~~~~~~~~~~ 328 (350)
++|++++.++..+..+++...
T Consensus 304 ~~l~Va~~~s~~v~vf~~d~~ 324 (345)
T PF10282_consen 304 RYLYVANQDSNTVSVFDIDPD 324 (345)
T ss_dssp SEEEEEETTTTEEEEEEEETT
T ss_pred CEEEEEecCCCeEEEEEEeCC
Confidence 999999866656666666433
No 217
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=99.50 E-value=4.7e-13 Score=115.22 Aligned_cols=137 Identities=14% Similarity=0.260 Sum_probs=101.5
Q ss_pred ccCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCC------------Cc--------------eeEecCCCCCCeeEEE
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEG------------KD--------------ACILTSDSQRDVKVLE 151 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~------------~~--------------~~~~~~~~~~~v~~~~ 151 (350)
...|+|+.|-|.+ ..++++-.+|.+.+||.....+ .. +..+. --.+.|..++
T Consensus 219 ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~t~ksk~~rNPv~~w~-~~~g~in~f~ 297 (636)
T KOG2394|consen 219 KSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAILTSKSKKTRNPVARWH-IGEGSINEFA 297 (636)
T ss_pred ccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEeeeeccccCCccceeE-ecccccccee
Confidence 3579999999965 4445567889999997642111 00 01111 1234789999
Q ss_pred EeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEE
Q 018806 152 WRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASAS 231 (350)
Q Consensus 152 ~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~ 231 (350)
|+|||++|++++.||.++|+|+........ ++.. -+...+++|||||++|++++
T Consensus 298 FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~-------------------------mkSY-FGGLLCvcWSPDGKyIvtGG 351 (636)
T KOG2394|consen 298 FSPDGKYLATVSQDGFLRIFDFDTQELLGV-------------------------MKSY-FGGLLCVCWSPDGKYIVTGG 351 (636)
T ss_pred EcCCCceEEEEecCceEEEeeccHHHHHHH-------------------------HHhh-ccceEEEEEcCCccEEEecC
Confidence 999999999999999999999984333222 2222 26889999999999999999
Q ss_pred eCCCeEEEEeCCCCCcee-eeecCCCeEEEEEc
Q 018806 232 YESSSFTIWDVAQGLGTP-IRRGFGGLSILKWS 263 (350)
Q Consensus 232 ~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~s 263 (350)
.|+ -|.||.+..++.+. -.+|+.+|..++|.
T Consensus 352 EDD-LVtVwSf~erRVVARGqGHkSWVs~VaFD 383 (636)
T KOG2394|consen 352 EDD-LVTVWSFEERRVVARGQGHKSWVSVVAFD 383 (636)
T ss_pred Ccc-eEEEEEeccceEEEeccccccceeeEeec
Confidence 997 99999998876553 45688999999998
No 218
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.49 E-value=1.2e-13 Score=124.64 Aligned_cols=198 Identities=16% Similarity=0.132 Sum_probs=141.6
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
...|+|+.|...|.+|++|+.|..++||..++ +.+.... .+|.+.|+.++.+.+.-.+++++.|..|++|.+..+..
T Consensus 190 ~naVyca~fDrtg~~Iitgsdd~lvKiwS~et--~~~lAs~-rGhs~ditdlavs~~n~~iaaaS~D~vIrvWrl~~~~p 266 (1113)
T KOG0644|consen 190 RNAVYCAIFDRTGRYIITGSDDRLVKIWSMET--ARCLASC-RGHSGDITDLAVSSNNTMIAAASNDKVIRVWRLPDGAP 266 (1113)
T ss_pred hhheeeeeeccccceEeecCccceeeeeeccc--hhhhccC-CCCccccchhccchhhhhhhhcccCceEEEEecCCCch
Confidence 34699999999999999999999999999754 6655555 58999999999998866667777799999999984332
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee-----eec
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI-----RRG 253 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~-----~~~ 253 (350)
+..+.+|. +.|++++|+|-. +.+.| |++++||.+-...... ...
T Consensus 267 -------------------------vsvLrght-gavtaiafsP~~----sss~d-gt~~~wd~r~~~~~y~prp~~~~~ 315 (1113)
T KOG0644|consen 267 -------------------------VSVLRGHT-GAVTAIAFSPRA----SSSDD-GTCRIWDARLEPRIYVPRPLKFTE 315 (1113)
T ss_pred -------------------------HHHHhccc-cceeeeccCccc----cCCCC-CceEeccccccccccCCCCCCccc
Confidence 34478887 799999999965 44556 8999999881100000 000
Q ss_pred C--------------------------CCeEEEEEcCCCCEEE-----------EEecCCeEEEEeCCCCce-eccccCC
Q 018806 254 F--------------------------GGLSILKWSPTGDYFF-----------AAKFDGTFYLWETNTWTS-EPWSSTS 295 (350)
Q Consensus 254 ~--------------------------~~v~~~~~sp~g~~l~-----------~~~~d~~v~iwd~~~~~~-~~~~~~~ 295 (350)
. ....+++|...+-.++ ++-.+..+++|++.+|.. ..+.+|.
T Consensus 316 ~~~~~s~~~~~~~~~f~Tgs~d~ea~n~e~~~l~~~~~~lif~t~ssd~~~~~~~ar~~~~~~vwnl~~g~l~H~l~ghs 395 (1113)
T KOG0644|consen 316 KDLVDSILFENNGDRFLTGSRDGEARNHEFEQLAWRSNLLIFVTRSSDLSSIVVTARNDHRLCVWNLYTGQLLHNLMGHS 395 (1113)
T ss_pred ccceeeeeccccccccccccCCcccccchhhHhhhhccceEEEeccccccccceeeeeeeEeeeeecccchhhhhhcccc
Confidence 0 1122233333222223 333455788899988876 4567889
Q ss_pred CCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC
Q 018806 296 GFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP 330 (350)
Q Consensus 296 ~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~ 330 (350)
..+..+.++|-...++...+.+.....|++|...+
T Consensus 396 d~~yvLd~Hpfn~ri~msag~dgst~iwdi~eg~p 430 (1113)
T KOG0644|consen 396 DEVYVLDVHPFNPRIAMSAGYDGSTIIWDIWEGIP 430 (1113)
T ss_pred cceeeeeecCCCcHhhhhccCCCceEeeecccCCc
Confidence 99999999998888877665556677888886544
No 219
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.48 E-value=2.3e-11 Score=109.11 Aligned_cols=195 Identities=19% Similarity=0.338 Sum_probs=141.8
Q ss_pred CeeEEEE-ecCCC-EEEEEEC-CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCC
Q 018806 101 DLQGVSW-HQHKH-IVAFISG-STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~-sp~g~-~la~~s~-d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~ 176 (350)
.+..+.+ ++++. .++..+. |+.+.+|+... ..........|...|..++|+|++..++.++. ++.+++|+....
T Consensus 111 ~~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~--~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 188 (466)
T COG2319 111 SVSKLALSSPDGNSILLASSSLDGTVKLWDLST--PGKLIRTLEGHSESVTSLAFSPDGKLLASGSSLDGTIKLWDLRTG 188 (466)
T ss_pred ceeeEEEECCCcceEEeccCCCCccEEEEEecC--CCeEEEEEecCcccEEEEEECCCCCEEEecCCCCCceEEEEcCCC
Confidence 4666666 78887 5555444 99999999853 12223333578899999999999887777765 899999999842
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCC-eEEEEEeCCCeEEEEeCCCCCcee--eeec
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGR-YLASASYESSSFTIWDVAQGLGTP--IRRG 253 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~-~l~~~~~d~g~i~iwd~~~~~~~~--~~~~ 253 (350)
. ....+.+|. ..+.+++|+|++. .+++++.| +.|++||...+.... +..|
T Consensus 189 ~-------------------------~~~~~~~~~-~~v~~~~~~~~~~~~~~~~~~d-~~i~~wd~~~~~~~~~~~~~~ 241 (466)
T COG2319 189 K-------------------------PLSTLAGHT-DPVSSLAFSPDGGLLIASGSSD-GTIRLWDLSTGKLLRSTLSGH 241 (466)
T ss_pred c-------------------------eEEeeccCC-CceEEEEEcCCcceEEEEecCC-CcEEEEECCCCcEEeeecCCC
Confidence 1 133345554 6999999999998 44444777 699999988666554 3345
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
.... ...|+|++..+++++.|+.+++|+.+.... .....|...+.++.|+|++..+++++.. ..+..|+..
T Consensus 242 ~~~~-~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~d-~~~~~~~~~ 314 (466)
T COG2319 242 SDSV-VSSFSPDGSLLASGSSDGTIRLWDLRSSSSLLRTLSGHSSSVLSVAFSPDGKLLASGSSD-GTVRLWDLE 314 (466)
T ss_pred Ccce-eEeECCCCCEEEEecCCCcEEEeeecCCCcEEEEEecCCccEEEEEECCCCCEEEEeeCC-CcEEEEEcC
Confidence 4443 338999998889999999999999987664 2234678899999999999998885533 334444443
No 220
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.48 E-value=4.8e-12 Score=104.35 Aligned_cols=154 Identities=17% Similarity=0.253 Sum_probs=114.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecC--CCCCCeeEEEEeeCCCeEEEEec-C-CcEEEEecCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTS--DSQRDVKVLEWRPNGGRSLSVGC-K-GGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~--~~~~~v~~~~~sp~~~~l~~~~~-d-~~v~iwd~~~~ 176 (350)
+|.+|.++. ++|+++-.+. |+|||+.. .+.+..+.. .+...+.++++++.+.++++-+. + |.|.+||...-
T Consensus 89 ~IL~VrmNr--~RLvV~Lee~-IyIydI~~--MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl 163 (391)
T KOG2110|consen 89 SILAVRMNR--KRLVVCLEES-IYIYDIKD--MKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTINL 163 (391)
T ss_pred ceEEEEEcc--ceEEEEEccc-EEEEeccc--ceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceEEEEEcccc
Confidence 567777764 4566655554 99999953 555554432 35556777777776667777555 3 99999999832
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ec--
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RG-- 253 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~-- 253 (350)
.....+..|. +.+.+++|+++|.+||+++..+-.||++.+.+|+....+ .+
T Consensus 164 -------------------------~~v~~I~aH~-~~lAalafs~~G~llATASeKGTVIRVf~v~~G~kl~eFRRG~~ 217 (391)
T KOG2110|consen 164 -------------------------QPVNTINAHK-GPLAALAFSPDGTLLATASEKGTVIRVFSVPEGQKLYEFRRGTY 217 (391)
T ss_pred -------------------------eeeeEEEecC-CceeEEEECCCCCEEEEeccCceEEEEEEcCCccEeeeeeCCce
Confidence 2345567775 799999999999999999988335799999999876433 33
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~ 285 (350)
...|.+++|+|++++|++.+..++|+||.++.
T Consensus 218 ~~~IySL~Fs~ds~~L~~sS~TeTVHiFKL~~ 249 (391)
T KOG2110|consen 218 PVSIYSLSFSPDSQFLAASSNTETVHIFKLEK 249 (391)
T ss_pred eeEEEEEEECCCCCeEEEecCCCeEEEEEecc
Confidence 24588999999999999999999999998864
No 221
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=99.46 E-value=1.3e-12 Score=103.11 Aligned_cols=170 Identities=15% Similarity=0.236 Sum_probs=121.5
Q ss_pred CCCcCCCCccCeeEEEEec-CCC--EEEEEECCCeEEEEEccCCCC-------CceeEecCCCCCCeeEEEEeeCCCeEE
Q 018806 91 PDHVHLLPEVDLQGVSWHQ-HKH--IVAFISGSTQVIVRDYEDSEG-------KDACILTSDSQRDVKVLEWRPNGGRSL 160 (350)
Q Consensus 91 p~~~~~~~~~~V~~v~~sp-~g~--~la~~s~d~~i~iw~~~~~~~-------~~~~~~~~~~~~~v~~~~~sp~~~~l~ 160 (350)
+++........|.+..|.. ++. +|+.|..+|.+.+||+...+. .....-...|..+|.++.+.+.-.+=+
T Consensus 142 ~dd~~~~Klgsvmc~~~~~~c~s~~lllaGyEsghvv~wd~S~~~~~~~~~~~~kv~~~~ash~qpvlsldyas~~~rGi 221 (323)
T KOG0322|consen 142 ADDSERSKLGSVMCQDKDHACGSTFLLLAGYESGHVVIWDLSTGDKIIQLPQSSKVESPNASHKQPVLSLDYASSCDRGI 221 (323)
T ss_pred cCchhccccCceeeeeccccccceEEEEEeccCCeEEEEEccCCceeeccccccccccchhhccCcceeeeechhhcCCc
Confidence 3333444444677776543 332 455667899999999975311 011112235889999999987655666
Q ss_pred EEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEE
Q 018806 161 SVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIW 240 (350)
Q Consensus 161 ~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iw 240 (350)
.++.+..+..|.+.......++.. .+.-.+ -.+..+..-||++.+|+++.| |.|++|
T Consensus 222 sgga~dkl~~~Sl~~s~gslq~~~---------------------e~~lkn-pGv~gvrIRpD~KIlATAGWD-~RiRVy 278 (323)
T KOG0322|consen 222 SGGADDKLVMYSLNHSTGSLQIRK---------------------EITLKN-PGVSGVRIRPDGKILATAGWD-HRIRVY 278 (323)
T ss_pred CCCccccceeeeeccccCcccccc---------------------eEEecC-CCccceEEccCCcEEeecccC-CcEEEE
Confidence 777778888998874322222111 111112 368889999999999999999 799999
Q ss_pred eCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 241 DVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 241 d~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
+.++.....+ ..|...|.+++|+|+...+|.++.|+.|.+|++
T Consensus 279 swrtl~pLAVLkyHsagvn~vAfspd~~lmAaaskD~rISLWkL 322 (323)
T KOG0322|consen 279 SWRTLNPLAVLKYHSAGVNAVAFSPDCELMAAASKDARISLWKL 322 (323)
T ss_pred EeccCCchhhhhhhhcceeEEEeCCCCchhhhccCCceEEeeec
Confidence 9999987664 458899999999999999999999999999986
No 222
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=99.45 E-value=1.9e-10 Score=95.16 Aligned_cols=212 Identities=13% Similarity=0.219 Sum_probs=144.6
Q ss_pred cCeeEEEEecCCCEEEEEEC---CCeEEEEEccCCCCCceeEecC-CCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecC
Q 018806 100 VDLQGVSWHQHKHIVAFISG---STQVIVRDYEDSEGKDACILTS-DSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPS 174 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~---d~~i~iw~~~~~~~~~~~~~~~-~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~ 174 (350)
..++=++|+|++++|.++.. +|.|..|.++..+|.....-.. ....+-..++++++|+.++++... |.|.++-+.
T Consensus 40 ~nptyl~~~~~~~~LY~v~~~~~~ggvaay~iD~~~G~Lt~ln~~~~~g~~p~yvsvd~~g~~vf~AnY~~g~v~v~p~~ 119 (346)
T COG2706 40 GNPTYLAVNPDQRHLYVVNEPGEEGGVAAYRIDPDDGRLTFLNRQTLPGSPPCYVSVDEDGRFVFVANYHSGSVSVYPLQ 119 (346)
T ss_pred CCCceEEECCCCCEEEEEEecCCcCcEEEEEEcCCCCeEEEeeccccCCCCCeEEEECCCCCEEEEEEccCceEEEEEcc
Confidence 35778999999999998754 5788888887544543222111 122344889999998888887775 999999997
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCC----CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN----GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI 250 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~----~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~ 250 (350)
..+......... ...-.+.+ ...+....+.|++++|++.....-.|.+|++..++....
T Consensus 120 ~dG~l~~~v~~~-----------------~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri~~y~~~dg~L~~~ 182 (346)
T COG2706 120 ADGSLQPVVQVV-----------------KHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGTDRIFLYDLDDGKLTPA 182 (346)
T ss_pred cCCccccceeee-----------------ecCCCCCCccccCCccceeeeCCCCCEEEEeecCCceEEEEEcccCccccc
Confidence 655443321110 00001000 123788999999999998864323899999998865432
Q ss_pred e----ecCCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCC--Cceeccc---------cCCCCeEEEEEcCCCCEEEEEE
Q 018806 251 R----RGFGGLSILKWSPTGDYFFAAKF-DGTFYLWETNT--WTSEPWS---------STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 251 ~----~~~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~--~~~~~~~---------~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
. ....+.+.+.|+|++++..+..+ +++|.+|..+. ++...++ ....+...+..++||++|+++.
T Consensus 183 ~~~~v~~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasN 262 (346)
T COG2706 183 DPAEVKPGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASN 262 (346)
T ss_pred cccccCCCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEec
Confidence 2 33467889999999999866654 89999999887 4443322 2345678899999999999887
Q ss_pred CCCeEEEEEEeCCC
Q 018806 315 AGSLTLGSIHFASK 328 (350)
Q Consensus 315 ~~~~~~~~~~~~~~ 328 (350)
.+...++..++...
T Consensus 263 Rg~dsI~~f~V~~~ 276 (346)
T COG2706 263 RGHDSIAVFSVDPD 276 (346)
T ss_pred CCCCeEEEEEEcCC
Confidence 55556666666543
No 223
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.45 E-value=3.1e-13 Score=114.36 Aligned_cols=198 Identities=16% Similarity=0.183 Sum_probs=161.3
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
.+.-+.+.++.+|++|+.|+..|.+..+|+.+ +...+.+. -...|.++.|-.+ ..+++++..+.++|||-. +..
T Consensus 129 eFGPY~~~ytrnGrhlllgGrKGHlAa~Dw~t--~~L~~Ei~--v~Etv~Dv~~LHn-eq~~AVAQK~y~yvYD~~-GtE 202 (545)
T KOG1272|consen 129 EFGPYHLDYTRNGRHLLLGGRKGHLAAFDWVT--KKLHFEIN--VMETVRDVTFLHN-EQFFAVAQKKYVYVYDNN-GTE 202 (545)
T ss_pred ccCCeeeeecCCccEEEecCCccceeeeeccc--ceeeeeee--hhhhhhhhhhhcc-hHHHHhhhhceEEEecCC-CcE
Confidence 44568889999999999999999999999954 55555553 4567999999887 788888999999999976 221
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCe
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGL 257 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v 257 (350)
...++.+ ..|..+.|-|..-.|++++.. |.++.-|+.+|+... +....+.+
T Consensus 203 -------------------------lHClk~~--~~v~rLeFLPyHfLL~~~~~~-G~L~Y~DVS~GklVa~~~t~~G~~ 254 (545)
T KOG1272|consen 203 -------------------------LHCLKRH--IRVARLEFLPYHFLLVAASEA-GFLKYQDVSTGKLVASIRTGAGRT 254 (545)
T ss_pred -------------------------Eeehhhc--CchhhhcccchhheeeecccC-CceEEEeechhhhhHHHHccCCcc
Confidence 1223333 588999999987777777777 899999999998765 44566888
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCC
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPP 330 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~ 330 (350)
..++-+|-...+-+|..+|+|.+|.....+. ..+..|.++|.++++.++|+++++++ |....||+++......
T Consensus 255 ~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiLcH~g~V~siAv~~~G~YMaTtG~Dr~~kIWDlR~~~ql~ 329 (545)
T KOG1272|consen 255 DVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKILCHRGPVSSIAVDRGGRYMATTGLDRKVKIWDLRNFYQLH 329 (545)
T ss_pred chhhcCCccceEEEcCCCceEEecCCCCcchHHHHHhcCCCcceEEECCCCcEEeecccccceeEeeeccccccc
Confidence 8899999888899999999999999988776 56789999999999999999999988 7778888888776443
No 224
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=99.44 E-value=5.1e-12 Score=109.51 Aligned_cols=187 Identities=14% Similarity=0.153 Sum_probs=131.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCC-------CCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEe
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS-------EGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWA 172 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~-------~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd 172 (350)
.+|-|+.+.++++.+++|+-||+|+.|++... +.........+|.+.|+.+++|+...+|++++.||+++.|+
T Consensus 345 gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr~w~ 424 (577)
T KOG0642|consen 345 GPVLCVVVPSNGEHCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSSTKDRLLSCSSDGTVRLWE 424 (577)
T ss_pred CceEEEEecCCceEEEeeccCceeeeeccCCCCCcccccCcchhccceeccccceeeeeecccccceeeecCCceEEeec
Confidence 37999999999999999999999999966411 01122233358999999999999988999999999999999
Q ss_pred cCCCCCCceeeccccc-ccceecC--------------C--CCCc------eEEeee--ccCC-CCCceeeEEECCCCCe
Q 018806 173 PSYPGNAASVRSGAAS-FLGALSR--------------G--PGTR------WTLVDF--LRSQ-NGEQITALSWGPDGRY 226 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~-~~~~~~~--------------~--~~~~------~~~~~~--~~~~-~~~~v~~~~~sp~g~~ 226 (350)
...... ..+...... .-..+.+ + .-.. +..... ..+. ....+..+.++|.+..
T Consensus 425 ~~~~~~-~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~~~~~ 503 (577)
T KOG0642|consen 425 PTEESP-CTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHPTADI 503 (577)
T ss_pred cCCcCc-cccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecCCCCe
Confidence 873322 111111000 0000000 0 0000 001110 1111 0135677889999988
Q ss_pred EEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 227 LASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 227 l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
.+++..+ +.|+++|..++.... ...|...++++++.|+|-+|++++.|+.+++|.+....+
T Consensus 504 ~~~~hed-~~Ir~~dn~~~~~l~s~~a~~~svtslai~~ng~~l~s~s~d~sv~l~kld~k~~ 565 (577)
T KOG0642|consen 504 TFTAHED-RSIRFFDNKTGKILHSMVAHKDSVTSLAIDPNGPYLMSGSHDGSVRLWKLDVKTC 565 (577)
T ss_pred eEecccC-CceecccccccccchheeeccceecceeecCCCceEEeecCCceeehhhccchhe
Confidence 8888888 699999999998764 667889999999999999999999999999999977655
No 225
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=99.44 E-value=2.1e-11 Score=99.27 Aligned_cols=221 Identities=15% Similarity=0.249 Sum_probs=146.0
Q ss_pred eeEEEEecCCCEEEE-EECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCC
Q 018806 102 LQGVSWHQHKHIVAF-ISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNA 179 (350)
Q Consensus 102 V~~v~~sp~g~~la~-~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~ 179 (350)
|.-+.|..|..+++. ...++.|.+|++.. ..-.+.+. ....++.+++|||||++++..+. +-.|.+|.+.+....
T Consensus 51 i~yieW~ads~~ilC~~yk~~~vqvwsl~Q--pew~ckId-eg~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~ 127 (447)
T KOG4497|consen 51 IVYIEWKADSCHILCVAYKDPKVQVWSLVQ--PEWYCKID-EGQAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGY 127 (447)
T ss_pred hhheeeeccceeeeeeeeccceEEEEEeec--ceeEEEec-cCCCcceeeeECCCcceEeeeecceeEEEEEEeccceeE
Confidence 566889888876665 46788999999964 44445553 45678999999999988887766 799999999743211
Q ss_pred cee------ecccccccc-------------------------------------eecCCCCCceE-Eeee------ccC
Q 018806 180 ASV------RSGAASFLG-------------------------------------ALSRGPGTRWT-LVDF------LRS 209 (350)
Q Consensus 180 ~~~------~~~~~~~~~-------------------------------------~~~~~~~~~~~-~~~~------~~~ 209 (350)
..- ...++.+.+ .+.+++++.|. +++. +.-
T Consensus 128 ~~~~pK~~~kg~~f~~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~~Leykv~aY 207 (447)
T KOG4497|consen 128 LLPHPKTNVKGYAFHPDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDNVLEYKVYAY 207 (447)
T ss_pred EecccccCceeEEECCCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecchhhheeeee
Confidence 100 000111111 13334455443 2221 122
Q ss_pred CCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC--------------------------------------------
Q 018806 210 QNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-------------------------------------------- 245 (350)
Q Consensus 210 ~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-------------------------------------------- 245 (350)
+..-.+..++|+|-+++|+.|+.| +.+++.+--+-
T Consensus 208 e~~lG~k~v~wsP~~qflavGsyD-~~lrvlnh~tWk~f~eflhl~s~~dp~~~~~~ke~~~~~ql~~~cLsf~p~~~~a 286 (447)
T KOG4497|consen 208 ERGLGLKFVEWSPCNQFLAVGSYD-QMLRVLNHFTWKPFGEFLHLCSYHDPTLHLLEKETFSIVQLLHHCLSFTPTDLEA 286 (447)
T ss_pred eeccceeEEEeccccceEEeeccc-hhhhhhceeeeeehhhhccchhccCchhhhhhhhhcchhhhcccccccCCCcccc
Confidence 223467889999999999999999 67776432110
Q ss_pred ----------C----cee---ee------ecCCCeEEEEEcCCCCEEEEEecC--CeEEEEeCCCCceeccccCCCCeEE
Q 018806 246 ----------L----GTP---IR------RGFGGLSILKWSPTGDYFFAAKFD--GTFYLWETNTWTSEPWSSTSGFVTG 300 (350)
Q Consensus 246 ----------~----~~~---~~------~~~~~v~~~~~sp~g~~l~~~~~d--~~v~iwd~~~~~~~~~~~~~~~v~~ 300 (350)
+ ... +. ...-++.-++|++|..++++-.+. +.+.+||++..+.........+|..
T Consensus 287 ~~~~~se~~YE~~~~pv~~~~lkp~tD~pnPk~g~g~lafs~Ds~y~aTrnd~~PnalW~Wdlq~l~l~avLiQk~pira 366 (447)
T KOG4497|consen 287 HIWEESETIYEQQMTPVKVHKLKPPTDFPNPKCGAGKLAFSCDSTYAATRNDKYPNALWLWDLQNLKLHAVLIQKHPIRA 366 (447)
T ss_pred CccccchhhhhhhhcceeeecccCCCCCCCcccccceeeecCCceEEeeecCCCCceEEEEechhhhhhhhhhhccceeE
Confidence 0 000 00 011246679999999999887543 5899999999888766667789999
Q ss_pred EEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 301 ATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 301 ~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
..|+|....|+.+.++ ++++.|....
T Consensus 367 f~WdP~~prL~vctg~-srLY~W~psg 392 (447)
T KOG4497|consen 367 FEWDPGRPRLVVCTGK-SRLYFWAPSG 392 (447)
T ss_pred EEeCCCCceEEEEcCC-ceEEEEcCCC
Confidence 9999999888876544 4677776544
No 226
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=99.44 E-value=1.2e-11 Score=112.52 Aligned_cols=217 Identities=14% Similarity=0.212 Sum_probs=150.8
Q ss_pred EEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC---eEEEEecCCcEEEEecCCCCCCce
Q 018806 105 VSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG---RSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 105 v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~---~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
..||+|+++++.. .+..|.||...+ +.++..+ .+|..++..+.+.|... .+++++.+|.|++||...+...+.
T Consensus 22 avfSnD~k~l~~~-~~~~V~VyS~~T--g~~i~~l-~~~~a~l~s~~~~~~~~~~~~~~~~sl~G~I~vwd~~~~~Llkt 97 (792)
T KOG1963|consen 22 AVFSNDAKFLFLC-TGNFVKVYSTAT--GECITSL-EDHTAPLTSVIVLPSSENANYLIVCSLDGTIRVWDWSDGELLKT 97 (792)
T ss_pred cccccCCcEEEEe-eCCEEEEEecch--Hhhhhhc-ccccCccceeeecCCCccceEEEEEecCccEEEecCCCcEEEEE
Confidence 4688999988765 456799999854 7776644 58999999999988754 345667799999999874332222
Q ss_pred eecccccc------------------------cc---------------------------------eecCCCCCceE--
Q 018806 182 VRSGAASF------------------------LG---------------------------------ALSRGPGTRWT-- 202 (350)
Q Consensus 182 ~~~~~~~~------------------------~~---------------------------------~~~~~~~~~~~-- 202 (350)
+....... .. .+..++.+.+.
T Consensus 98 ~~~~~~v~~~~~~~~~a~~s~~~~~s~~~~~~~~~~s~~~~~q~~~~~~~t~~~~~~d~~~~~~~~~~I~~~~~ge~~~i 177 (792)
T KOG1963|consen 98 FDNNLPVHALVYKPAQADISANVYVSVEDYSILTTFSKKLSKQSSRFVLATFDSAKGDFLKEHQEPKSIVDNNSGEFKGI 177 (792)
T ss_pred EecCCceeEEEechhHhCccceeEeecccceeeeecccccccceeeeEeeeccccchhhhhhhcCCccEEEcCCceEEEE
Confidence 21110000 00 00001111111
Q ss_pred -------Eee-----------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC--C---CceeeeecCCCeEE
Q 018806 203 -------LVD-----------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ--G---LGTPIRRGFGGLSI 259 (350)
Q Consensus 203 -------~~~-----------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~--~---~~~~~~~~~~~v~~ 259 (350)
.+. ...-|+...+++.++||.+++++++..| |.|.+|.--. . .+..+.-|...|.+
T Consensus 178 ~~~~~~~~~~v~~~~~~~~~~~~~~~Htf~~t~~~~spn~~~~Aa~d~d-GrI~vw~d~~~~~~~~t~t~lHWH~~~V~~ 256 (792)
T KOG1963|consen 178 VHMCKIHIYFVPKHTKHTSSRDITVHHTFNITCVALSPNERYLAAGDSD-GRILVWRDFGSSDDSETCTLLHWHHDEVNS 256 (792)
T ss_pred EEeeeEEEEEecccceeeccchhhhhhcccceeEEeccccceEEEeccC-CcEEEEeccccccccccceEEEecccccce
Confidence 000 0111222357889999999999999999 8999996443 2 23455668899999
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
++|+++|.+|++|+..+.+-+|.+.+++.+-+..-.++|..+.+|||+.+.+..+. +..+..++..+
T Consensus 257 L~fS~~G~~LlSGG~E~VLv~Wq~~T~~kqfLPRLgs~I~~i~vS~ds~~~sl~~~-DNqI~li~~~d 323 (792)
T KOG1963|consen 257 LSFSSDGAYLLSGGREGVLVLWQLETGKKQFLPRLGSPILHIVVSPDSDLYSLVLE-DNQIHLIKASD 323 (792)
T ss_pred eEEecCCceEeecccceEEEEEeecCCCcccccccCCeeEEEEEcCCCCeEEEEec-CceEEEEeccc
Confidence 99999999999999999999999999997667788899999999999999887763 23455555543
No 227
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.44 E-value=1e-10 Score=104.96 Aligned_cols=200 Identities=24% Similarity=0.401 Sum_probs=144.2
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE-eeCCC-eEEEEec-CCcEEEEecC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW-RPNGG-RSLSVGC-KGGICIWAPS 174 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~-sp~~~-~l~~~~~-d~~v~iwd~~ 174 (350)
+...+.++.+++.+..++.++.|+.+.+|+..... .....+...+...+..+.+ ++++. .++..+. ++.+.+|+..
T Consensus 64 ~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~ 142 (466)
T COG2319 64 HEDSITSIAFSPDGELLLSGSSDGTIKLWDLDNGE-KLIKSLEGLHDSSVSKLALSSPDGNSILLASSSLDGTVKLWDLS 142 (466)
T ss_pred ccceEEEEEECCCCcEEEEecCCCcEEEEEcCCCc-eeEEEEeccCCCceeeEEEECCCcceEEeccCCCCccEEEEEec
Confidence 34579999999999999999999999999986422 1333332223246777777 77766 3444445 7999999998
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe-CCCeEEEEeCCCCCcee-eee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY-ESSSFTIWDVAQGLGTP-IRR 252 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d~g~i~iwd~~~~~~~~-~~~ 252 (350)
.. ......+..|. ..|..++|+|+++.++.++. + +.+++|+...+.... +..
T Consensus 143 ~~------------------------~~~~~~~~~~~-~~v~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~ 196 (466)
T COG2319 143 TP------------------------GKLIRTLEGHS-ESVTSLAFSPDGKLLASGSSLD-GTIKLWDLRTGKPLSTLAG 196 (466)
T ss_pred CC------------------------CeEEEEEecCc-ccEEEEEECCCCCEEEecCCCC-CceEEEEcCCCceEEeecc
Confidence 40 11234456665 68899999999998888875 7 699999999865554 444
Q ss_pred cCCCeEEEEEcCCCC-EEEEEecCCeEEEEeCCCCceec--cccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 253 GFGGLSILKWSPTGD-YFFAAKFDGTFYLWETNTWTSEP--WSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~-~l~~~~~d~~v~iwd~~~~~~~~--~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
|...+.+++|+|++. .+++++.|+.|++||...+.... +..|.... -..|+|++.++++++ ++...++..+.
T Consensus 197 ~~~~v~~~~~~~~~~~~~~~~~~d~~i~~wd~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~d~~~~~~~~~~ 272 (466)
T COG2319 197 HTDPVSSLAFSPDGGLLIASGSSDGTIRLWDLSTGKLLRSTLSGHSDSV-VSSFSPDGSLLASGSSDGTIRLWDLRS 272 (466)
T ss_pred CCCceEEEEEcCCcceEEEEecCCCcEEEEECCCCcEEeeecCCCCcce-eEeECCCCCEEEEecCCCcEEEeeecC
Confidence 788999999999998 55555899999999988776644 56666664 338999997777554 44445554443
No 228
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.43 E-value=2.7e-13 Score=114.72 Aligned_cols=187 Identities=16% Similarity=0.216 Sum_probs=142.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~~ 179 (350)
.|.++.|-.+.+++|++ ....++|||-. |..+..+. . ...|..+.|-|. ..|++++++ |.++--|+..++..
T Consensus 172 tv~Dv~~LHneq~~AVA-QK~y~yvYD~~---GtElHClk-~-~~~v~rLeFLPy-HfLL~~~~~~G~L~Y~DVS~GklV 244 (545)
T KOG1272|consen 172 TVRDVTFLHNEQFFAVA-QKKYVYVYDNN---GTELHCLK-R-HIRVARLEFLPY-HFLLVAASEAGFLKYQDVSTGKLV 244 (545)
T ss_pred hhhhhhhhcchHHHHhh-hhceEEEecCC---CcEEeehh-h-cCchhhhcccch-hheeeecccCCceEEEeechhhhh
Confidence 58889999888988875 56678899953 66666553 3 357999999998 666666665 99999999977776
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce-eeeecCCCeE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT-PIRRGFGGLS 258 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~~v~ 258 (350)
..+.++ .+.+..+.-+|-.-.+-.|... |+|.+|.-...+.. .+..|.++|.
T Consensus 245 a~~~t~--------------------------~G~~~vm~qNP~NaVih~Ghsn-GtVSlWSP~skePLvKiLcH~g~V~ 297 (545)
T KOG1272|consen 245 ASIRTG--------------------------AGRTDVMKQNPYNAVIHLGHSN-GTVSLWSPNSKEPLVKILCHRGPVS 297 (545)
T ss_pred HHHHcc--------------------------CCccchhhcCCccceEEEcCCC-ceEEecCCCCcchHHHHHhcCCCcc
Confidence 665554 2677888888988778788777 89999999887754 5788999999
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEE
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGS 322 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~ 322 (350)
++++.++|+++++.+.|+.++|||+++...........+...+++|..|- ||.+.+....+|.
T Consensus 298 siAv~~~G~YMaTtG~Dr~~kIWDlR~~~ql~t~~tp~~a~~ls~Sqkgl-LA~~~G~~v~iw~ 360 (545)
T KOG1272|consen 298 SIAVDRGGRYMATTGLDRKVKIWDLRNFYQLHTYRTPHPASNLSLSQKGL-LALSYGDHVQIWK 360 (545)
T ss_pred eEEECCCCcEEeecccccceeEeeeccccccceeecCCCccccccccccc-eeeecCCeeeeeh
Confidence 99999999999999999999999999877532222245677888887653 4444344344443
No 229
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.41 E-value=4.2e-11 Score=104.59 Aligned_cols=191 Identities=13% Similarity=0.122 Sum_probs=137.5
Q ss_pred cCCCEEEEEECCCeEEEEEccCCCCCceeEecC--CCCCCeeEEEEe------e-------------CCCeEEEEec-CC
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDSEGKDACILTS--DSQRDVKVLEWR------P-------------NGGRSLSVGC-KG 166 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~--~~~~~v~~~~~s------p-------------~~~~l~~~~~-d~ 166 (350)
|-+.++|....||.++||+...+ +....+.. .-.+...+..|. | .+..+++-|. .|
T Consensus 3 ~~~~~~A~~~~~g~l~iw~t~~~--~~~~e~~p~~~~s~t~~~~~w~L~~~~s~~k~~~~~~~~~~s~~t~~lvlgt~~g 80 (541)
T KOG4547|consen 3 PALDYFALSTGDGRLRIWDTAKN--QLQQEFAPIASLSGTCTYTKWGLSADYSPMKWLSLEKAKKASLDTSMLVLGTPQG 80 (541)
T ss_pred chhheEeecCCCCeEEEEEccCc--eeeeeeccchhccCcceeEEEEEEeccchHHHHhHHHHhhccCCceEEEeecCCc
Confidence 45678999999999999998643 22222211 123455555552 1 1133444444 58
Q ss_pred cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC
Q 018806 167 GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL 246 (350)
Q Consensus 167 ~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~ 246 (350)
.|.+|++..++-...+.+ ..| .+.|.++.++.+-..|.+++.| +.+..|+...+.
T Consensus 81 ~v~~ys~~~g~it~~~st-----------------------~~h-~~~v~~~~~~~~~~ciyS~~ad-~~v~~~~~~~~~ 135 (541)
T KOG4547|consen 81 SVLLYSVAGGEITAKLST-----------------------DKH-YGNVNEILDAQRLGCIYSVGAD-LKVVYILEKEKV 135 (541)
T ss_pred cEEEEEecCCeEEEEEec-----------------------CCC-CCcceeeecccccCceEecCCc-eeEEEEecccce
Confidence 888888874433222221 234 5799999999999999999999 699999999887
Q ss_pred ceeeee-cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCC-----CCEEEEEEC--CC
Q 018806 247 GTPIRR-GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPE-----GRMILLAFA--GS 317 (350)
Q Consensus 247 ~~~~~~-~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~-----g~~l~~~~~--~~ 317 (350)
...+.. .+..+.+++.+|||..+++++ +.|++||+++++. ..+.+|.++|..++|--+ |.+++++.. ..
T Consensus 136 ~~~~~~~~~~~~~sl~is~D~~~l~~as--~~ik~~~~~~kevv~~ftgh~s~v~t~~f~~~~~g~~G~~vLssa~~~r~ 213 (541)
T KOG4547|consen 136 IIRIWKEQKPLVSSLCISPDGKILLTAS--RQIKVLDIETKEVVITFTGHGSPVRTLSFTTLIDGIIGKYVLSSAAAERG 213 (541)
T ss_pred eeeeeccCCCccceEEEcCCCCEEEecc--ceEEEEEccCceEEEEecCCCcceEEEEEEEeccccccceeeeccccccc
Confidence 766554 456788999999999999886 7899999999998 678899999999999887 888887653 33
Q ss_pred eEEEEEEeCCC
Q 018806 318 LTLGSIHFASK 328 (350)
Q Consensus 318 ~~~~~~~~~~~ 328 (350)
+.+|.++...+
T Consensus 214 i~~w~v~~~~k 224 (541)
T KOG4547|consen 214 ITVWVVEKEDK 224 (541)
T ss_pred eeEEEEEcccc
Confidence 55666665444
No 230
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.40 E-value=1e-11 Score=115.12 Aligned_cols=186 Identities=15% Similarity=0.138 Sum_probs=130.8
Q ss_pred eEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC-CCeEEEEecCCcEEEEecCCCCCCce
Q 018806 103 QGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN-GGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
.-+.|.....+|++++.-..|+|||.+. ......+..+....|+++.-+-. |+.++++-.||.|++||.+.......
T Consensus 1169 ~v~dWqQ~~G~Ll~tGd~r~IRIWDa~~--E~~~~diP~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~ 1246 (1387)
T KOG1517|consen 1169 LVVDWQQQSGHLLVTGDVRSIRIWDAHK--EQVVADIPYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSL 1246 (1387)
T ss_pred eeeehhhhCCeEEecCCeeEEEEEeccc--ceeEeecccCCCccceeecccccCCceEEEeecCCceEEeecccCCcccc
Confidence 3456777666777777788999999963 34444444455667777765443 45666666689999999985433211
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCC-CceeeEEECCCCCe-EEEEEeCCCeEEEEeCCCCCcee---eeecC--
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNG-EQITALSWGPDGRY-LASASYESSSFTIWDVAQGLGTP---IRRGF-- 254 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~v~~~~~sp~g~~-l~~~~~d~g~i~iwd~~~~~~~~---~~~~~-- 254 (350)
+...+.|+. .+|..+.+.+.|-. |++++.+ |.|++||++...... +..|-
T Consensus 1247 ----------------------v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~-G~I~~~DlR~~~~e~~~~iv~~~~y 1303 (1387)
T KOG1517|consen 1247 ----------------------VCVYREHNDVEPIVHLSLQRQGLGELVSGSQD-GDIQLLDLRMSSKETFLTIVAHWEY 1303 (1387)
T ss_pred ----------------------ceeecccCCcccceeEEeecCCCcceeeeccC-CeEEEEecccCcccccceeeecccc
Confidence 233444441 23899999987654 9999999 899999999843222 22222
Q ss_pred C-CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-------cCCCCeEEEEEcCCCCEEEEEE
Q 018806 255 G-GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-------STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 255 ~-~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-------~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+ ..+++..+++...+|+|+. +.|+||++...+...+. ...+.+.+++|+|.--+|++|.
T Consensus 1304 Gs~lTal~VH~hapiiAsGs~-q~ikIy~~~G~~l~~~k~n~~F~~q~~gs~scL~FHP~~~llAaG~ 1370 (1387)
T KOG1517|consen 1304 GSALTALTVHEHAPIIASGSA-QLIKIYSLSGEQLNIIKYNPGFMGQRIGSVSCLAFHPHRLLLAAGS 1370 (1387)
T ss_pred CccceeeeeccCCCeeeecCc-ceEEEEecChhhhcccccCcccccCcCCCcceeeecchhHhhhhcc
Confidence 3 4899999999999999998 99999999876653322 2345679999999888888774
No 231
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.40 E-value=1.5e-10 Score=101.41 Aligned_cols=218 Identities=17% Similarity=0.261 Sum_probs=126.9
Q ss_pred eEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCce
Q 018806 103 QGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAAS 181 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~ 181 (350)
..+.|+|||+++++++.||.|.++|+.. .+....+.. .....++++++||++++++.. .+.+.++|..+.+....
T Consensus 40 ~~~~~s~Dgr~~yv~~rdg~vsviD~~~--~~~v~~i~~--G~~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~ 115 (369)
T PF02239_consen 40 AGLKFSPDGRYLYVANRDGTVSVIDLAT--GKVVATIKV--GGNPRGIAVSPDGKYVYVANYEPGTVSVIDAETLEPVKT 115 (369)
T ss_dssp EEEE-TT-SSEEEEEETTSEEEEEETTS--SSEEEEEE---SSEEEEEEE--TTTEEEEEEEETTEEEEEETTT--EEEE
T ss_pred eEEEecCCCCEEEEEcCCCeEEEEECCc--ccEEEEEec--CCCcceEEEcCCCCEEEEEecCCCceeEeccccccceee
Confidence 3467899999999999999999999954 565566543 445789999999988887776 59999999986655555
Q ss_pred eeccccc------ccceecCCCCCc-e----------EEee----------eccCCCCCceeeEEECCCCCeEEEEEeCC
Q 018806 182 VRSGAAS------FLGALSRGPGTR-W----------TLVD----------FLRSQNGEQITALSWGPDGRYLASASYES 234 (350)
Q Consensus 182 ~~~~~~~------~~~~~~~~~~~~-~----------~~~~----------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~ 234 (350)
+...... ....+..++... | -+.+ .+. .........|+|++++++.+...+
T Consensus 116 I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vVdy~d~~~~~~~~i~--~g~~~~D~~~dpdgry~~va~~~s 193 (369)
T PF02239_consen 116 IPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVVDYSDPKNLKVTTIK--VGRFPHDGGFDPDGRYFLVAANGS 193 (369)
T ss_dssp EE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEEETTTSSCEEEEEEE----TTEEEEEE-TTSSEEEEEEGGG
T ss_pred cccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEEEeccccccceeeec--ccccccccccCcccceeeeccccc
Confidence 5433211 111122222211 1 1111 111 123567889999999987765443
Q ss_pred CeEEEEeCCCCCceeee-------------------------------------------------------ecCCCeEE
Q 018806 235 SSFTIWDVAQGLGTPIR-------------------------------------------------------RGFGGLSI 259 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~-------------------------------------------------------~~~~~v~~ 259 (350)
..|-++|.++++..... ...+.-.-
T Consensus 194 n~i~viD~~~~k~v~~i~~g~~p~~~~~~~~php~~g~vw~~~~~~~~~~~~ig~~~v~v~d~~~wkvv~~I~~~G~glF 273 (369)
T PF02239_consen 194 NKIAVIDTKTGKLVALIDTGKKPHPGPGANFPHPGFGPVWATSGLGYFAIPLIGTDPVSVHDDYAWKVVKTIPTQGGGLF 273 (369)
T ss_dssp TEEEEEETTTTEEEEEEE-SSSBEETTEEEEEETTTEEEEEEEBSSSSEEEEEE--TTT-STTTBTSEEEEEE-SSSS--
T ss_pred ceeEEEeeccceEEEEeeccccccccccccccCCCcceEEeeccccceecccccCCccccchhhcCeEEEEEECCCCcce
Confidence 58888887766221110 00111144
Q ss_pred EEEcCCCCEEEEE----ecCCeEEEEeCCCCcee-ccc-cCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeC
Q 018806 260 LKWSPTGDYFFAA----KFDGTFYLWETNTWTSE-PWS-STSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFA 326 (350)
Q Consensus 260 ~~~sp~g~~l~~~----~~d~~v~iwd~~~~~~~-~~~-~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~ 326 (350)
+..+|+++++.+. ...++|.++|.++.+.. .+. .....+..+.|+++|+++.++. +....+..++-.
T Consensus 274 i~thP~s~~vwvd~~~~~~~~~v~viD~~tl~~~~~i~~~~~~~~~h~ef~~dG~~v~vS~~~~~~~i~v~D~~ 347 (369)
T PF02239_consen 274 IKTHPDSRYVWVDTFLNPDADTVQVIDKKTLKVVKTITPGPGKRVVHMEFNPDGKEVWVSVWDGNGAIVVYDAK 347 (369)
T ss_dssp EE--TT-SEEEEE-TT-SSHT-EEEEECCGTEEEE-HHHHHT--EEEEEE-TTSSEEEEEEE--TTEEEEEETT
T ss_pred eecCCCCccEEeeccCCCCCceEEEEECcCcceeEEEeccCCCcEeccEECCCCCEEEEEEecCCCEEEEEECC
Confidence 6678999999877 44579999999998763 332 2233589999999999998887 333355555543
No 232
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=99.38 E-value=1.2e-09 Score=90.52 Aligned_cols=205 Identities=15% Similarity=0.189 Sum_probs=139.1
Q ss_pred ccCeeEEEEecCCCEEEEEEC-CCeEEEEEccCCCCCceeE-ecCCCCCC----------eeEEEEeeCCCeEEEEecC-
Q 018806 99 EVDLQGVSWHQHKHIVAFISG-STQVIVRDYEDSEGKDACI-LTSDSQRD----------VKVLEWRPNGGRSLSVGCK- 165 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~-d~~i~iw~~~~~~~~~~~~-~~~~~~~~----------v~~~~~sp~~~~l~~~~~d- 165 (350)
+.+-.-++++++|++|+++.. .|.|.++.+... |..... -...|.+. +....+.|+++.+++..-.
T Consensus 88 g~~p~yvsvd~~g~~vf~AnY~~g~v~v~p~~~d-G~l~~~v~~~~h~g~~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~ 166 (346)
T COG2706 88 GSPPCYVSVDEDGRFVFVANYHSGSVSVYPLQAD-GSLQPVVQVVKHTGSGPHERQESPHVHSANFTPDGRYLVVPDLGT 166 (346)
T ss_pred CCCCeEEEECCCCCEEEEEEccCceEEEEEcccC-CccccceeeeecCCCCCCccccCCccceeeeCCCCCEEEEeecCC
Confidence 445588999999999999875 688999988543 322211 11234444 8899999998787777664
Q ss_pred CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC-
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ- 244 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~- 244 (350)
..|.+|++. .+........ .+ ......+.|.|+|++++.+..++-+++|.+|..+.
T Consensus 167 Dri~~y~~~-dg~L~~~~~~--------------------~v--~~G~GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~ 223 (346)
T COG2706 167 DRIFLYDLD-DGKLTPADPA--------------------EV--KPGAGPRHIVFHPNGKYAYLVNELNSTVDVLEYNPA 223 (346)
T ss_pred ceEEEEEcc-cCcccccccc--------------------cc--CCCCCcceEEEcCCCcEEEEEeccCCEEEEEEEcCC
Confidence 889999998 3332222111 01 12356789999999999988887667999999887
Q ss_pred -CCceeeee---------cCCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCC--Ccee---ccccCCCCeEEEEEcCCCC
Q 018806 245 -GLGTPIRR---------GFGGLSILKWSPTGDYFFAAKF-DGTFYLWETNT--WTSE---PWSSTSGFVTGATWDPEGR 308 (350)
Q Consensus 245 -~~~~~~~~---------~~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~--~~~~---~~~~~~~~v~~~~~s~~g~ 308 (350)
++...++. ...+...+.+++||++|.++.. ...|.+|.+.. ++.. ....+........|++.|+
T Consensus 224 ~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasNRg~dsI~~f~V~~~~g~L~~~~~~~teg~~PR~F~i~~~g~ 303 (346)
T COG2706 224 VGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASNRGHDSIAVFSVDPDGGKLELVGITPTEGQFPRDFNINPSGR 303 (346)
T ss_pred CceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEecCCCCeEEEEEEcCCCCEEEEEEEeccCCcCCccceeCCCCC
Confidence 33333321 2356778899999999987754 34788887653 4432 2223444578899999999
Q ss_pred EEEEEECCCeEEEEEEeCC
Q 018806 309 MILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 309 ~l~~~~~~~~~~~~~~~~~ 327 (350)
+|+++..++..+.......
T Consensus 304 ~Liaa~q~sd~i~vf~~d~ 322 (346)
T COG2706 304 FLIAANQKSDNITVFERDK 322 (346)
T ss_pred EEEEEccCCCcEEEEEEcC
Confidence 9999984443444444443
No 233
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=99.38 E-value=1.7e-11 Score=108.55 Aligned_cols=195 Identities=16% Similarity=0.182 Sum_probs=128.5
Q ss_pred ccchhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCce--------eEec--
Q 018806 71 EGLFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDA--------CILT-- 140 (350)
Q Consensus 71 ~~~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~--------~~~~-- 140 (350)
..++.+|.||.+. |++++|+.||+++|+|+.|+.+.+|.... +|... +..+
T Consensus 43 G~llqtLKgHKDt------------------VycVAys~dGkrFASG~aDK~VI~W~~kl-EG~LkYSH~D~IQCMsFNP 103 (1081)
T KOG1538|consen 43 GTLLQPLKGHKDT------------------VYCVAYAKDGKRFASGSADKSVIIWTSKL-EGILKYSHNDAIQCMSFNP 103 (1081)
T ss_pred cccccccccccce------------------EEEEEEccCCceeccCCCceeEEEecccc-cceeeeccCCeeeEeecCc
Confidence 4556777777655 99999999999999999999999998642 11100 0000
Q ss_pred -------------------------CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeec-ccccccceec
Q 018806 141 -------------------------SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRS-GAASFLGALS 194 (350)
Q Consensus 141 -------------------------~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~-~~~~~~~~~~ 194 (350)
......|.+++|..||+.++.+-.+|+|.|-+-........-.+ +..+++.++.
T Consensus 104 ~~h~LasCsLsdFglWS~~qK~V~K~kss~R~~~CsWtnDGqylalG~~nGTIsiRNk~gEek~~I~Rpgg~Nspiwsi~ 183 (1081)
T KOG1538|consen 104 ITHQLASCSLSDFGLWSPEQKSVSKHKSSSRIICCSWTNDGQYLALGMFNGTISIRNKNGEEKVKIERPGGSNSPIWSIC 183 (1081)
T ss_pred hHHHhhhcchhhccccChhhhhHHhhhhheeEEEeeecCCCcEEEEeccCceEEeecCCCCcceEEeCCCCCCCCceEEE
Confidence 01123467778888877777777789988876542222222222 2345555555
Q ss_pred CCCCCc-----------eE---EeeeccCCC-------CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec
Q 018806 195 RGPGTR-----------WT---LVDFLRSQN-------GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG 253 (350)
Q Consensus 195 ~~~~~~-----------~~---~~~~~~~~~-------~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~ 253 (350)
+++... |. ...++.|.. +-...++++.++|.+++.|+.| +.+.+|--+.-..-.+-..
T Consensus 184 ~~p~sg~G~~di~aV~DW~qTLSFy~LsG~~Igk~r~L~FdP~CisYf~NGEy~LiGGsd-k~L~~fTR~GvrLGTvg~~ 262 (1081)
T KOG1538|consen 184 WNPSSGEGRNDILAVADWGQTLSFYQLSGKQIGKDRALNFDPCCISYFTNGEYILLGGSD-KQLSLFTRDGVRLGTVGEQ 262 (1081)
T ss_pred ecCCCCCCccceEEEEeccceeEEEEecceeecccccCCCCchhheeccCCcEEEEccCC-CceEEEeecCeEEeecccc
Confidence 554322 11 111222211 1245688899999999999999 5999986543222233335
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~ 285 (350)
+.+|+.++..|+++.++.|+.||+|.-|++-.
T Consensus 263 D~WIWtV~~~PNsQ~v~~GCqDGTiACyNl~f 294 (1081)
T KOG1538|consen 263 DSWIWTVQAKPNSQYVVVGCQDGTIACYNLIF 294 (1081)
T ss_pred ceeEEEEEEccCCceEEEEEccCeeehhhhHH
Confidence 68899999999999999999999999998753
No 234
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=99.37 E-value=1.2e-09 Score=95.74 Aligned_cols=213 Identities=15% Similarity=0.227 Sum_probs=137.2
Q ss_pred CeeEEEEecCCCEEEEEEC----CCeEEEEEccCCCCCceeEecCC-CCCCeeEEEEeeCCCeEEEEec-CCcEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISG----STQVIVRDYEDSEGKDACILTSD-SQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~----d~~i~iw~~~~~~~~~~~~~~~~-~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~ 174 (350)
....++++|++++|.++.. ++.|..|.++..++.....-... .......++++|+++.++++.. ++.+.++++.
T Consensus 38 ~Ps~l~~~~~~~~LY~~~e~~~~~g~v~~~~i~~~~g~L~~~~~~~~~g~~p~~i~~~~~g~~l~vany~~g~v~v~~l~ 117 (345)
T PF10282_consen 38 NPSWLAVSPDGRRLYVVNEGSGDSGGVSSYRIDPDTGTLTLLNSVPSGGSSPCHIAVDPDGRFLYVANYGGGSVSVFPLD 117 (345)
T ss_dssp SECCEEE-TTSSEEEEEETTSSTTTEEEEEEEETTTTEEEEEEEEEESSSCEEEEEECTTSSEEEEEETTTTEEEEEEEC
T ss_pred CCceEEEEeCCCEEEEEEccccCCCCEEEEEECCCcceeEEeeeeccCCCCcEEEEEecCCCEEEEEEccCCeEEEEEcc
Confidence 4677899999999998876 57999999875433322221111 3345667999999888888876 6999999998
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeec-cCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC--cee--
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFL-RSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL--GTP-- 249 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~--~~~-- 249 (350)
..+......... ...+ ...- .........++.|+|+|+++++.......|.+|++.... ...
T Consensus 118 ~~g~l~~~~~~~-~~~g------------~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~ 184 (345)
T PF10282_consen 118 DDGSLGEVVQTV-RHEG------------SGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVD 184 (345)
T ss_dssp TTSEEEEEEEEE-ESEE------------EESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEE
T ss_pred CCcccceeeeec-ccCC------------CCCcccccccccceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEee
Confidence 654433321100 0000 0000 001124678999999999998876544589999998765 322
Q ss_pred -e-eecCCCeEEEEEcCCCCEEEEEe-cCCeEEEEeCC--CCceeccc---------cCCCCeEEEEEcCCCCEEEEEEC
Q 018806 250 -I-RRGFGGLSILKWSPTGDYFFAAK-FDGTFYLWETN--TWTSEPWS---------STSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 250 -~-~~~~~~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~--~~~~~~~~---------~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
+ .......+.++|+|+|+++++.. .+++|.++++. +++..... ........++++|||++|+++..
T Consensus 185 ~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~i~ispdg~~lyvsnr 264 (345)
T PF10282_consen 185 SIKVPPGSGPRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEGFTGENAPAEIAISPDGRFLYVSNR 264 (345)
T ss_dssp EEECSTTSSEEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETTSCSSSSEEEEEE-TTSSEEEEEEC
T ss_pred ccccccCCCCcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeeccccccccCCceeEEEecCCCEEEEEec
Confidence 1 12346789999999999986665 47889999988 44432111 11225789999999999999986
Q ss_pred CCeEEEEEEeC
Q 018806 316 GSLTLGSIHFA 326 (350)
Q Consensus 316 ~~~~~~~~~~~ 326 (350)
+...|..+++.
T Consensus 265 ~~~sI~vf~~d 275 (345)
T PF10282_consen 265 GSNSISVFDLD 275 (345)
T ss_dssp TTTEEEEEEEC
T ss_pred cCCEEEEEEEe
Confidence 66666666663
No 235
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.37 E-value=6.6e-11 Score=98.41 Aligned_cols=194 Identities=11% Similarity=0.091 Sum_probs=139.0
Q ss_pred CEEEEEECCCeEEEEEccCCC--CCceeEecCCCCCCeeEEEEeeCCCeEEEEec-C--CcEEEEecCCCCCCceeeccc
Q 018806 112 HIVAFISGSTQVIVRDYEDSE--GKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-K--GGICIWAPSYPGNAASVRSGA 186 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~--~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d--~~v~iwd~~~~~~~~~~~~~~ 186 (350)
..|++|-.+|.+.+|....+. ......+ .....+..+.-++....+++.|. . ..+.|||++.. .++...+
T Consensus 116 g~Litc~~sG~l~~~~~k~~d~hss~l~~l--a~g~g~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~---~qiw~aK 190 (412)
T KOG3881|consen 116 GTLITCVSSGNLQVRHDKSGDLHSSKLIKL--ATGPGLYDVRQTDTDPYIVATGGKENINELKIWDLEQS---KQIWSAK 190 (412)
T ss_pred CEEEEEecCCcEEEEeccCCccccccceee--ecCCceeeeccCCCCCceEecCchhcccceeeeecccc---eeeeecc
Confidence 356778899999999986433 2222333 23356788888887777777555 5 78999999854 2222221
Q ss_pred ccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEEEEeCCCeEEEEeCCCCCcee--eeecCCCeEEEEE
Q 018806 187 ASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLASASYESSSFTIWDVAQGLGTP--IRRGFGGLSILKW 262 (350)
Q Consensus 187 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~g~i~iwd~~~~~~~~--~~~~~~~v~~~~~ 262 (350)
..+. +.+.-.-+-+++++.|-+. ...|++++.- +.+++||.+.+.... +.-...+++++..
T Consensus 191 Nvpn--------------D~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~-hqvR~YDt~~qRRPV~~fd~~E~~is~~~l 255 (412)
T KOG3881|consen 191 NVPN--------------DRLGLRVPVWITDIRFLEGSPNYKFATITRY-HQVRLYDTRHQRRPVAQFDFLENPISSTGL 255 (412)
T ss_pred CCCC--------------ccccceeeeeeccceecCCCCCceEEEEecc-eeEEEecCcccCcceeEeccccCcceeeee
Confidence 1110 0111111346788999887 7899999998 699999999665432 2224688999999
Q ss_pred cCCCCEEEEEecCCeEEEEeCCCCcee--ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 263 SPTGDYFFAAKFDGTFYLWETNTWTSE--PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 263 sp~g~~l~~~~~d~~v~iwd~~~~~~~--~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
.|.|++|++|...+.+..||++.++.. .+.+..+.|.++..+|.+++|++++ |.-.+|++++.
T Consensus 256 ~p~gn~Iy~gn~~g~l~~FD~r~~kl~g~~~kg~tGsirsih~hp~~~~las~GLDRyvRIhD~kt 321 (412)
T KOG3881|consen 256 TPSGNFIYTGNTKGQLAKFDLRGGKLLGCGLKGITGSIRSIHCHPTHPVLASCGLDRYVRIHDIKT 321 (412)
T ss_pred cCCCcEEEEecccchhheecccCceeeccccCCccCCcceEEEcCCCceEEeeccceeEEEeeccc
Confidence 999999999999999999999999983 3678889999999999999999886 54455555544
No 236
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=99.36 E-value=1.4e-10 Score=94.86 Aligned_cols=161 Identities=15% Similarity=0.230 Sum_probs=115.3
Q ss_pred CeeEEEEec--CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCC-CCeeEEEEeeCCCeEEEEec-----CCcEEEEe
Q 018806 101 DLQGVSWHQ--HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQ-RDVKVLEWRPNGGRSLSVGC-----KGGICIWA 172 (350)
Q Consensus 101 ~V~~v~~sp--~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~-~~v~~~~~sp~~~~l~~~~~-----d~~v~iwd 172 (350)
.+..+.|.. ..+.+.+|+.||+|++||+............ ++. .+..+++-.-. ..++++|. +-.|.+||
T Consensus 72 ~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~~~-~~~~~~f~~ld~nck-~~ii~~GtE~~~s~A~v~lwD 149 (376)
T KOG1188|consen 72 TTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAESARISWT-QQSGTPFICLDLNCK-KNIIACGTELTRSDASVVLWD 149 (376)
T ss_pred cccceEEecCCCCCeeEEeccCCeEEEEEeecchhhhheecc-CCCCCcceEeeccCc-CCeEEeccccccCceEEEEEE
Confidence 356677765 4578889999999999999764444333332 343 45666666545 55666665 36789999
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc----
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLG---- 247 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~---- 247 (350)
++..... + -.....|+ ..|+++.|+|. ...|++|+.| |-|.+||++....
T Consensus 150 vR~~qq~--l---------------------~~~~eSH~-DDVT~lrFHP~~pnlLlSGSvD-GLvnlfD~~~d~EeDaL 204 (376)
T KOG1188|consen 150 VRSEQQL--L---------------------RQLNESHN-DDVTQLRFHPSDPNLLLSGSVD-GLVNLFDTKKDNEEDAL 204 (376)
T ss_pred eccccch--h---------------------hhhhhhcc-CcceeEEecCCCCCeEEeeccc-ceEEeeecCCCcchhhH
Confidence 9854431 1 11134565 69999999995 5678899999 8999999986532
Q ss_pred eeeeecCCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCce
Q 018806 248 TPIRRGFGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 248 ~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
.....+...|.++.|..++ +.|.+-+...+.++|+++.+..
T Consensus 205 ~~viN~~sSI~~igw~~~~ykrI~clTH~Etf~~~ele~~~~ 246 (376)
T KOG1188|consen 205 LHVINHGSSIHLIGWLSKKYKRIMCLTHMETFAIYELEDGSE 246 (376)
T ss_pred HHhhcccceeeeeeeecCCcceEEEEEccCceeEEEccCCCh
Confidence 2344566779999999887 4578888899999999998875
No 237
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=99.35 E-value=5e-11 Score=97.63 Aligned_cols=234 Identities=15% Similarity=0.178 Sum_probs=148.0
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCC-CC-ceeEecCCC------------CCCeeEEEEeeCCC--eEEEEe
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSE-GK-DACILTSDS------------QRDVKVLEWRPNGG--RSLSVG 163 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~-~~-~~~~~~~~~------------~~~v~~~~~sp~~~--~l~~~~ 163 (350)
.-+.+|.|...|.+||+|..+|.|-++.-+... +. .....++.| ...|..++|.++++ .++.++
T Consensus 26 diis~vef~~~Ge~LatGdkgGRVv~f~r~~~~~~ey~~~t~fqshepEFDYLkSleieEKinkIrw~~~~n~a~FLlst 105 (433)
T KOG1354|consen 26 DIISAVEFDHYGERLATGDKGGRVVLFEREKLYKGEYNFQTEFQSHEPEFDYLKSLEIEEKINKIRWLDDGNLAEFLLST 105 (433)
T ss_pred cceeeEEeecccceEeecCCCCeEEEeecccccccceeeeeeeeccCcccchhhhhhhhhhhhhceecCCCCccEEEEec
Confidence 348999999999999999999999988754221 11 011222223 23688999988754 577778
Q ss_pred cCCcEEEEecCCCCCCcee----ecccccccceecC---CCCC---ceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC
Q 018806 164 CKGGICIWAPSYPGNAASV----RSGAASFLGALSR---GPGT---RWTLVDFLRSQNGEQITALSWGPDGRYLASASYE 233 (350)
Q Consensus 164 ~d~~v~iwd~~~~~~~~~~----~~~~~~~~~~~~~---~~~~---~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d 233 (350)
.|.+|++|.+........- ..+....+..+.. .+-+ ...+.+.+...+.--|.+++++.|++.++++..
T Consensus 106 NdktiKlWKi~er~~k~~~~~~~~~~~~~~~~~lr~p~~~~~~~~vea~prRv~aNaHtyhiNSIS~NsD~Et~lSADd- 184 (433)
T KOG1354|consen 106 NDKTIKLWKIRERGSKKEGYNLPEEGPPGTITSLRLPVEGRHDLEVEASPRRVYANAHTYHINSISVNSDKETFLSADD- 184 (433)
T ss_pred CCcceeeeeeeccccccccccccccCCCCccceeeceeeccccceeeeeeeeeccccceeEeeeeeecCccceEeeccc-
Confidence 8999999999744332200 0011111111111 1111 112333343333467899999999999988743
Q ss_pred CCeEEEEeCCCCCc-e---eeeecC-----CCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCce----eccc-------
Q 018806 234 SSSFTIWDVAQGLG-T---PIRRGF-----GGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTS----EPWS------- 292 (350)
Q Consensus 234 ~g~i~iwd~~~~~~-~---~~~~~~-----~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~----~~~~------- 292 (350)
-.|.+|++.-... . -+..+. .-|++..|+|. ...++..+..|+|++-|++.... ..+.
T Consensus 185 -LRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~YSSSKGtIrLcDmR~~aLCd~hsKlfEepedp~ 263 (433)
T KOG1354|consen 185 -LRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVYSSSKGTIRLCDMRQSALCDAHSKLFEEPEDPS 263 (433)
T ss_pred -eeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEEecCCCcEEEeechhhhhhcchhhhhccccCCc
Confidence 3899999874322 1 122222 34788899995 56778888899999999985332 0111
Q ss_pred ------cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC-CCcee
Q 018806 293 ------STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP-SLDAH 335 (350)
Q Consensus 293 ------~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~-~~~~~ 335 (350)
.--..|..+.|+++|++|++-.--...+|++.+..++. ++..|
T Consensus 264 ~rsffseiIsSISDvKFs~sGryilsRDyltvk~wD~nme~~pv~t~~vh 313 (433)
T KOG1354|consen 264 SRSFFSEIISSISDVKFSHSGRYILSRDYLTVKLWDLNMEAKPVETYPVH 313 (433)
T ss_pred chhhHHHHhhhhhceEEccCCcEEEEeccceeEEEeccccCCcceEEeeh
Confidence 12346889999999999998765667777777777665 33344
No 238
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=99.35 E-value=4.3e-10 Score=98.56 Aligned_cols=187 Identities=19% Similarity=0.242 Sum_probs=124.1
Q ss_pred CEEE-EEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccccccc
Q 018806 112 HIVA-FISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFL 190 (350)
Q Consensus 112 ~~la-~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~ 190 (350)
++++ +-..++.+.+.|..+ .+....+..+ ...-..+.|+|||+++++++.|+.|.++|+...+....+..+
T Consensus 6 ~l~~V~~~~~~~v~viD~~t--~~~~~~i~~~-~~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~G----- 77 (369)
T PF02239_consen 6 NLFYVVERGSGSVAVIDGAT--NKVVARIPTG-GAPHAGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKVG----- 77 (369)
T ss_dssp GEEEEEEGGGTEEEEEETTT---SEEEEEE-S-TTEEEEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE-S-----
T ss_pred cEEEEEecCCCEEEEEECCC--CeEEEEEcCC-CCceeEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEecC-----
Confidence 4444 345689999999853 5555555422 223345789999998888888999999999966654444433
Q ss_pred ceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec--------CCCeEEEEE
Q 018806 191 GALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG--------FGGLSILKW 262 (350)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~--------~~~v~~~~~ 262 (350)
....++++|+||++++++....+.+.++|.++.+....... ...+..+..
T Consensus 78 ----------------------~~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~ 135 (369)
T PF02239_consen 78 ----------------------GNPRGIAVSPDGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVA 135 (369)
T ss_dssp ----------------------SEEEEEEE--TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE
T ss_pred ----------------------CCcceEEEcCCCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEe
Confidence 46788999999999998887657999999999876653321 235677878
Q ss_pred cCCCCEEEE-EecCCeEEEEeCCCCcee--ccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 263 SPTGDYFFA-AKFDGTFYLWETNTWTSE--PWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 263 sp~g~~l~~-~~~d~~v~iwd~~~~~~~--~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
+|....++. .-+.+.|.+.|....+.. .............|+|+|++++++...+..+..++....
T Consensus 136 s~~~~~fVv~lkd~~~I~vVdy~d~~~~~~~~i~~g~~~~D~~~dpdgry~~va~~~sn~i~viD~~~~ 204 (369)
T PF02239_consen 136 SPGRPEFVVNLKDTGEIWVVDYSDPKNLKVTTIKVGRFPHDGGFDPDGRYFLVAANGSNKIAVIDTKTG 204 (369)
T ss_dssp -SSSSEEEEEETTTTEEEEEETTTSSCEEEEEEE--TTEEEEEE-TTSSEEEEEEGGGTEEEEEETTTT
T ss_pred cCCCCEEEEEEccCCeEEEEEeccccccceeeecccccccccccCcccceeeecccccceeEEEeeccc
Confidence 888885554 455588999998776542 334455677889999999999988766667777776654
No 239
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=99.34 E-value=1.4e-09 Score=88.39 Aligned_cols=158 Identities=16% Similarity=0.266 Sum_probs=110.4
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecC-CCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTS-DSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~-~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~ 178 (350)
+|.+|.++++ +|++. .++.|.||.+..+ .+....+.. .....+.+++-+.+...|+.-|.. |.|+|-|+.....
T Consensus 96 ~I~~V~l~r~--riVvv-l~~~I~VytF~~n-~k~l~~~et~~NPkGlC~~~~~~~k~~LafPg~k~GqvQi~dL~~~~~ 171 (346)
T KOG2111|consen 96 EIKAVKLRRD--RIVVV-LENKIYVYTFPDN-PKLLHVIETRSNPKGLCSLCPTSNKSLLAFPGFKTGQVQIVDLASTKP 171 (346)
T ss_pred ceeeEEEcCC--eEEEE-ecCeEEEEEcCCC-hhheeeeecccCCCceEeecCCCCceEEEcCCCccceEEEEEhhhcCc
Confidence 6888888765 45443 5678999998632 333333322 224445555544443334444544 9999999973322
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-eeec--CC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-IRRG--FG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~--~~ 255 (350)
-. -..+..|. +.|.+++.+.+|..+|+++..+--|+|||..+|.... +..+ ..
T Consensus 172 ~~-----------------------p~~I~AH~-s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~RRG~d~A 227 (346)
T KOG2111|consen 172 NA-----------------------PSIINAHD-SDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELRRGVDRA 227 (346)
T ss_pred CC-----------------------ceEEEccc-CceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeeecCCchh
Confidence 10 12355664 8999999999999999999983248999999998654 3332 36
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCCCC
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETNTW 286 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~ 286 (350)
.+++++|||++.+||++++.|+|+||.++..
T Consensus 228 ~iy~iaFSp~~s~LavsSdKgTlHiF~l~~~ 258 (346)
T KOG2111|consen 228 DIYCIAFSPNSSWLAVSSDKGTLHIFSLRDT 258 (346)
T ss_pred eEEEEEeCCCccEEEEEcCCCeEEEEEeecC
Confidence 7999999999999999999999999988763
No 240
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=99.34 E-value=4.7e-12 Score=114.51 Aligned_cols=214 Identities=13% Similarity=0.210 Sum_probs=133.2
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
++.++.+.+..++|++|.|..|++|.+. .+..+..+ .+|.+.|++++|+|-. +++.||++++||.+.......
T Consensus 235 itdlavs~~n~~iaaaS~D~vIrvWrl~--~~~pvsvL-rghtgavtaiafsP~~----sss~dgt~~~wd~r~~~~~y~ 307 (1113)
T KOG0644|consen 235 ITDLAVSSNNTMIAAASNDKVIRVWRLP--DGAPVSVL-RGHTGAVTAIAFSPRA----SSSDDGTCRIWDARLEPRIYV 307 (1113)
T ss_pred cchhccchhhhhhhhcccCceEEEEecC--CCchHHHH-hccccceeeeccCccc----cCCCCCceEeccccccccccC
Confidence 7888888899999999999999999994 36655555 5999999999999972 666689999999982211111
Q ss_pred ---eecccccccceecCCCCC----------ceE--EeeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCC
Q 018806 182 ---VRSGAASFLGALSRGPGT----------RWT--LVDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVAQG 245 (350)
Q Consensus 182 ---~~~~~~~~~~~~~~~~~~----------~~~--~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~ 245 (350)
...........+-+.... .-. -...+..+. ..+.-+.++.+- .+.+++-.+ -.+++|++.++
T Consensus 308 prp~~~~~~~~~~s~~~~~~~~~f~Tgs~d~ea~n~e~~~l~~~~-~~lif~t~ssd~~~~~~~ar~~-~~~~vwnl~~g 385 (1113)
T KOG0644|consen 308 PRPLKFTEKDLVDSILFENNGDRFLTGSRDGEARNHEFEQLAWRS-NLLIFVTRSSDLSSIVVTARND-HRLCVWNLYTG 385 (1113)
T ss_pred CCCCCcccccceeeeeccccccccccccCCcccccchhhHhhhhc-cceEEEeccccccccceeeeee-eEeeeeecccc
Confidence 000000011111110000 000 000011111 112222222222 233344445 37899999999
Q ss_pred Ccee-eeecCCCeEEEEEcCCCCEE-EEEecCCeEEEEeCCCCceec--cccCCCCeEEEEEcCCCCEEEEEECCCeEEE
Q 018806 246 LGTP-IRRGFGGLSILKWSPTGDYF-FAAKFDGTFYLWETNTWTSEP--WSSTSGFVTGATWDPEGRMILLAFAGSLTLG 321 (350)
Q Consensus 246 ~~~~-~~~~~~~v~~~~~sp~g~~l-~~~~~d~~v~iwd~~~~~~~~--~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~ 321 (350)
.... ...|...++.+.++|-...+ .+++.||...|||+-.|...+ ..+| ..+...+||+||..++.. +..+.++
T Consensus 386 ~l~H~l~ghsd~~yvLd~Hpfn~ri~msag~dgst~iwdi~eg~pik~y~~gh-~kl~d~kFSqdgts~~ls-d~hgql~ 463 (1113)
T KOG0644|consen 386 QLLHNLMGHSDEVYVLDVHPFNPRIAMSAGYDGSTIIWDIWEGIPIKHYFIGH-GKLVDGKFSQDGTSIALS-DDHGQLY 463 (1113)
T ss_pred hhhhhhcccccceeeeeecCCCcHhhhhccCCCceEeeecccCCcceeeeccc-ceeeccccCCCCceEecC-CCCCceE
Confidence 7765 44677889999999966555 578899999999998877632 3444 456677999999988754 3334555
Q ss_pred EEEeC
Q 018806 322 SIHFA 326 (350)
Q Consensus 322 ~~~~~ 326 (350)
.+-..
T Consensus 464 i~g~g 468 (1113)
T KOG0644|consen 464 ILGTG 468 (1113)
T ss_pred EeccC
Confidence 55443
No 241
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=99.33 E-value=4.6e-11 Score=99.45 Aligned_cols=168 Identities=12% Similarity=0.131 Sum_probs=126.4
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG 221 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s 221 (350)
+|.+.|+++.|+.+++.|+++|.|..+++|+++.--....-. .+.....|+...|.+++|.
T Consensus 54 ~H~GCiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~K-------------------PI~~~~~~H~SNIF~L~F~ 114 (609)
T KOG4227|consen 54 EHTGCINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPK-------------------PIGVMEHPHRSNIFSLEFD 114 (609)
T ss_pred hhccccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCC-------------------CceeccCccccceEEEEEc
Confidence 699999999999998888888888999999987211100000 1222333445789999999
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC---CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-e---ccccC
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLGTPIRRGF---GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-E---PWSST 294 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~---~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~---~~~~~ 294 (350)
...+.++++..+ |+|..-|+.+.+.+.+..+. +.|+.+..+|..+.|++.+.++.|.+||.+.... . .....
T Consensus 115 ~~N~~~~SG~~~-~~VI~HDiEt~qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~~~~~~~~~~AN~ 193 (609)
T KOG4227|consen 115 LENRFLYSGERW-GTVIKHDIETKQSIYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDRQNPISLVLPANS 193 (609)
T ss_pred cCCeeEecCCCc-ceeEeeecccceeeeeecccCcccceeecccCCCCceEEEEecCceEEEEeccCCCCCCceeeecCC
Confidence 999999999999 79999999999888777665 5899999999999999999999999999987652 1 22234
Q ss_pred CCCeEEEEEcCCCCEEEEE-E-CCCeEEEEEEeCCCC
Q 018806 295 SGFVTGATWDPEGRMILLA-F-AGSLTLGSIHFASKP 329 (350)
Q Consensus 295 ~~~v~~~~~s~~g~~l~~~-~-~~~~~~~~~~~~~~~ 329 (350)
......+.|+|....|+.. . .+...+|++++...+
T Consensus 194 ~~~F~t~~F~P~~P~Li~~~~~~~G~~~~D~R~~~~~ 230 (609)
T KOG4227|consen 194 GKNFYTAEFHPETPALILVNSETGGPNVFDRRMQARP 230 (609)
T ss_pred CccceeeeecCCCceeEEeccccCCCCceeeccccch
Confidence 5567889999987665544 3 444567777766543
No 242
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=99.31 E-value=3.1e-10 Score=105.51 Aligned_cols=205 Identities=15% Similarity=0.174 Sum_probs=137.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCC--CCCCeeEEEEeeC--CCeEEEEecCCcEEEEecCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSD--SQRDVKVLEWRPN--GGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~--~~~~v~~~~~sp~--~~~l~~~~~d~~v~iwd~~~~ 176 (350)
+-..+.|+|-...++++...-.|+|||++. ++....+..+ ....|+.+.+-++ ...+++++.||.|+||+--..
T Consensus 1066 ~pk~~~~hpf~p~i~~ad~r~~i~vwd~e~--~~~l~~F~n~~~~~t~Vs~l~liNe~D~aLlLtas~dGvIRIwk~y~~ 1143 (1387)
T KOG1517|consen 1066 PPKTLKFHPFEPQIAAADDRERIRVWDWEK--GRLLNGFDNGAFPDTRVSDLELINEQDDALLLTASSDGVIRIWKDYAD 1143 (1387)
T ss_pred CCceeeecCCCceeEEcCCcceEEEEeccc--CceeccccCCCCCCCccceeeeecccchhheeeeccCceEEEeccccc
Confidence 467789999999999988778899999964 4433333221 3457899998653 356788888999999976533
Q ss_pred C-CCceeecccccccceecCCCCCceEEeeeccCCC---CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-
Q 018806 177 G-NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN---GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR- 251 (350)
Q Consensus 177 ~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~---~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~- 251 (350)
. ....+.+. |..+.++. .+.-.-+.|.....+|++++.-. .|+|||........-.
T Consensus 1144 ~~~~~eLVTa------------------w~~Ls~~~~~~r~~~~v~dWqQ~~G~Ll~tGd~r-~IRIWDa~~E~~~~diP 1204 (1387)
T KOG1517|consen 1144 KWKKPELVTA------------------WSSLSDQLPGARGTGLVVDWQQQSGHLLVTGDVR-SIRIWDAHKEQVVADIP 1204 (1387)
T ss_pred ccCCceeEEe------------------eccccccCccCCCCCeeeehhhhCCeEEecCCee-EEEEEecccceeEeecc
Confidence 2 22222111 22232221 11124467877766777776663 9999999876554322
Q ss_pred -ecCCCeEEEEEc-CCCCEEEEEecCCeEEEEeCCCCce----eccccCCCC--eEEEEEcCCCCE-EEEEE-CCCeEEE
Q 018806 252 -RGFGGLSILKWS-PTGDYFFAAKFDGTFYLWETNTWTS----EPWSSTSGF--VTGATWDPEGRM-ILLAF-AGSLTLG 321 (350)
Q Consensus 252 -~~~~~v~~~~~s-p~g~~l~~~~~d~~v~iwd~~~~~~----~~~~~~~~~--v~~~~~s~~g~~-l~~~~-~~~~~~~ 321 (350)
+....++++.-+ +.|..|++|-.||.|++||.+.... .....|... |..+.+.+.|-- |++++ ++++.++
T Consensus 1205 ~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~I~~~ 1284 (1387)
T KOG1517|consen 1205 YGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQDGDIQLL 1284 (1387)
T ss_pred cCCCccceeecccccCCceEEEeecCCceEEeecccCCccccceeecccCCcccceeEEeecCCCcceeeeccCCeEEEE
Confidence 223445555433 3478999999999999999987654 234567666 999999887754 77676 8888888
Q ss_pred EEEeC
Q 018806 322 SIHFA 326 (350)
Q Consensus 322 ~~~~~ 326 (350)
++++.
T Consensus 1285 DlR~~ 1289 (1387)
T KOG1517|consen 1285 DLRMS 1289 (1387)
T ss_pred ecccC
Confidence 88884
No 243
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=99.31 E-value=4.5e-10 Score=101.62 Aligned_cols=207 Identities=17% Similarity=0.191 Sum_probs=131.9
Q ss_pred ccCeeEEEEecCCCE--EEEEECCCeEEEEEccCCCCCceeE----ec-----CCCCCCeeEEEEeeCCCeEEEEecC-C
Q 018806 99 EVDLQGVSWHQHKHI--VAFISGSTQVIVRDYEDSEGKDACI----LT-----SDSQRDVKVLEWRPNGGRSLSVGCK-G 166 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~--la~~s~d~~i~iw~~~~~~~~~~~~----~~-----~~~~~~v~~~~~sp~~~~l~~~~~d-~ 166 (350)
..+|+.+.|-.+..- +++++.||.|..|+++.-....... .. ......+++++|.+.....+..|++ |
T Consensus 291 ~~~v~~vvW~~~~~~~~f~s~ssDG~i~~W~~~~l~~P~e~~~~~~~~~~~~~~~~~~~~t~~~F~~~~p~~FiVGTe~G 370 (555)
T KOG1587|consen 291 SEPVTAVVWLQNEHNTEFFSLSSDGSICSWDTDMLSLPVEGLLLESKKHKGQQSSKAVGATSLKFEPTDPNHFIVGTEEG 370 (555)
T ss_pred CcCeEEEEEeccCCCCceEEEecCCcEeeeeccccccchhhcccccccccccccccccceeeEeeccCCCceEEEEcCCc
Confidence 457999999776544 9999999999999875321100000 00 0122468999998876666666664 8
Q ss_pred cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC-CC
Q 018806 167 GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA-QG 245 (350)
Q Consensus 167 ~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~-~~ 245 (350)
.|.--+-. +....... .+.....+..| .+.|+.+.++|-+..++.++.| .+++||... ..
T Consensus 371 ~v~~~~r~-g~~~~~~~----------------~~~~~~~~~~h-~g~v~~v~~nPF~~k~fls~gD-W~vriWs~~~~~ 431 (555)
T KOG1587|consen 371 KVYKGCRK-GYTPAPEV----------------SYKGHSTFITH-IGPVYAVSRNPFYPKNFLSVGD-WTVRIWSEDVIA 431 (555)
T ss_pred EEEEEecc-CCcccccc----------------ccccccccccc-CcceEeeecCCCccceeeeecc-ceeEeccccCCC
Confidence 87653322 11111000 00112223444 3799999999987766666567 599999877 33
Q ss_pred Cce-eeeecCCCeEEEEEcCCCCE-EEEEecCCeEEEEeCCCCceec---cccCCCCeEEEEEcCCCCEEEEEECCCeEE
Q 018806 246 LGT-PIRRGFGGLSILKWSPTGDY-FFAAKFDGTFYLWETNTWTSEP---WSSTSGFVTGATWDPEGRMILLAFAGSLTL 320 (350)
Q Consensus 246 ~~~-~~~~~~~~v~~~~~sp~g~~-l~~~~~d~~v~iwd~~~~~~~~---~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~ 320 (350)
... ....+...+.+++|||...- ++++..||.+.+||+......+ ...+......+.|+++|+.|++|..+ +.+
T Consensus 432 ~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~l~iWDLl~~~~~Pv~s~~~~~~~l~~~~~s~~g~~lavGd~~-G~~ 510 (555)
T KOG1587|consen 432 SPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGNLDIWDLLQDDEEPVLSQKVCSPALTRVRWSPNGKLLAVGDAN-GTT 510 (555)
T ss_pred CcchhhhhccceeeeeEEcCcCceEEEEEcCCCceehhhhhccccCCcccccccccccceeecCCCCcEEEEecCC-CcE
Confidence 333 23345566999999998654 5777889999999997665532 22335566788999999999988633 234
Q ss_pred EEEEe
Q 018806 321 GSIHF 325 (350)
Q Consensus 321 ~~~~~ 325 (350)
..+++
T Consensus 511 ~~~~l 515 (555)
T KOG1587|consen 511 HILKL 515 (555)
T ss_pred EEEEc
Confidence 44444
No 244
>PRK04043 tolB translocation protein TolB; Provisional
Probab=99.29 E-value=3.3e-09 Score=94.70 Aligned_cols=173 Identities=10% Similarity=0.027 Sum_probs=112.3
Q ss_pred eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCe-EEEEecC---CcEEEEecCCCCCCceeecccccccceecCCC
Q 018806 122 QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGR-SLSVGCK---GGICIWAPSYPGNAASVRSGAASFLGALSRGP 197 (350)
Q Consensus 122 ~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~-l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 197 (350)
.|.+-|.+ +.....+..+ +.+....|+|||++ +++.+.+ ..|+++|+..+. ...+..
T Consensus 170 ~l~~~d~d---g~~~~~~~~~--~~~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~-~~~lt~------------- 230 (419)
T PRK04043 170 NIVLADYT---LTYQKVIVKG--GLNIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGK-KEKIAS------------- 230 (419)
T ss_pred eEEEECCC---CCceeEEccC--CCeEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCc-EEEEec-------------
Confidence 44454543 4444444433 37889999999986 5544443 457777776322 222111
Q ss_pred CCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC--CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC
Q 018806 198 GTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES--SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD 275 (350)
Q Consensus 198 ~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d 275 (350)
. .+......|+|||+.|+.....+ ..|+++|+.++....+..+........|+|||+.|+..+..
T Consensus 231 ------------~-~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~dl~~g~~~~LT~~~~~d~~p~~SPDG~~I~F~Sdr 297 (419)
T PRK04043 231 ------------S-QGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYDTNTKTLTQITNYPGIDVNGNFVEDDKRIVFVSDR 297 (419)
T ss_pred ------------C-CCcEEeeEECCCCCEEEEEEccCCCcEEEEEECCCCcEEEcccCCCccCccEECCCCCEEEEEECC
Confidence 1 24556788999999887654322 37888899888766665555444567899999988776542
Q ss_pred -C--eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC--------eEEEEEEeCCC
Q 018806 276 -G--TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS--------LTLGSIHFASK 328 (350)
Q Consensus 276 -~--~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~--------~~~~~~~~~~~ 328 (350)
+ .|+++|+.+++..++...... ...|||||++|+...... ..++.+++...
T Consensus 298 ~g~~~Iy~~dl~~g~~~rlt~~g~~--~~~~SPDG~~Ia~~~~~~~~~~~~~~~~I~v~d~~~g 359 (419)
T PRK04043 298 LGYPNIFMKKLNSGSVEQVVFHGKN--NSSVSTYKNYIVYSSRETNNEFGKNTFNLYLISTNSD 359 (419)
T ss_pred CCCceEEEEECCCCCeEeCccCCCc--CceECCCCCEEEEEEcCCCcccCCCCcEEEEEECCCC
Confidence 2 788999998888655433222 358999999999887322 46777776543
No 245
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=99.28 E-value=2.1e-10 Score=95.51 Aligned_cols=181 Identities=10% Similarity=0.064 Sum_probs=131.0
Q ss_pred ccCeeEEEEecCC-CEEEEEECC--CeEEEEEccCCCCCceeEecCC--------CCCCeeEEEEeeC--CCeEEEEecC
Q 018806 99 EVDLQGVSWHQHK-HIVAFISGS--TQVIVRDYEDSEGKDACILTSD--------SQRDVKVLEWRPN--GGRSLSVGCK 165 (350)
Q Consensus 99 ~~~V~~v~~sp~g-~~la~~s~d--~~i~iw~~~~~~~~~~~~~~~~--------~~~~v~~~~~sp~--~~~l~~~~~d 165 (350)
+..+..+.-++.- ..+|+|+.. ..+.|||++. .+.+-.-..- -.-.++++.|-+. ...++++..-
T Consensus 148 g~g~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~--~~qiw~aKNvpnD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~ 225 (412)
T KOG3881|consen 148 GPGLYDVRQTDTDPYIVATGGKENINELKIWDLEQ--SKQIWSAKNVPNDRLGLRVPVWITDIRFLEGSPNYKFATITRY 225 (412)
T ss_pred CCceeeeccCCCCCceEecCchhcccceeeeeccc--ceeeeeccCCCCccccceeeeeeccceecCCCCCceEEEEecc
Confidence 4566777666654 455668888 8899999964 2222211110 1124678888766 5778888888
Q ss_pred CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG 245 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~ 245 (350)
+.+++||...+..+..-.. -. ...++++...|+|+.|+++... |.+..||++.+
T Consensus 226 hqvR~YDt~~qRRPV~~fd------------------------~~-E~~is~~~l~p~gn~Iy~gn~~-g~l~~FD~r~~ 279 (412)
T KOG3881|consen 226 HQVRLYDTRHQRRPVAQFD------------------------FL-ENPISSTGLTPSGNFIYTGNTK-GQLAKFDLRGG 279 (412)
T ss_pred eeEEEecCcccCcceeEec------------------------cc-cCcceeeeecCCCcEEEEeccc-chhheecccCc
Confidence 9999999985554422111 11 3589999999999999999888 79999999998
Q ss_pred Ccee--eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCC
Q 018806 246 LGTP--IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 246 ~~~~--~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g 307 (350)
+..- +.+-.+.++++..+|.++++++++-|+.|+|+|+++.+...-..-...++.+.+.++-
T Consensus 280 kl~g~~~kg~tGsirsih~hp~~~~las~GLDRyvRIhD~ktrkll~kvYvKs~lt~il~~~~~ 343 (412)
T KOG3881|consen 280 KLLGCGLKGITGSIRSIHCHPTHPVLASCGLDRYVRIHDIKTRKLLHKVYVKSRLTFILLRDDV 343 (412)
T ss_pred eeeccccCCccCCcceEEEcCCCceEEeeccceeEEEeecccchhhhhhhhhccccEEEecCCc
Confidence 7653 3445688999999999999999999999999999997764433444566777776543
No 246
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=99.28 E-value=8.4e-10 Score=94.34 Aligned_cols=171 Identities=15% Similarity=0.265 Sum_probs=132.5
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCC-cEEEEecCCCCCCceeeccccc
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKG-GICIWAPSYPGNAASVRSGAAS 188 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~-~v~iwd~~~~~~~~~~~~~~~~ 188 (350)
+|.++|..|. |...|.+... + ..+..+|.+.|.-..+.-+++.++.+..|| .+-|+|.+.. ..+.
T Consensus 331 ~Gd~ia~VSR-GkaFi~~~~~--~---~~iqv~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~-e~kr------- 396 (668)
T COG4946 331 NGDYIALVSR-GKAFIMRPWD--G---YSIQVGKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGG-EVKR------- 396 (668)
T ss_pred CCcEEEEEec-CcEEEECCCC--C---eeEEcCCCCceEEEEEccCCcceEEeccCCceEEEEecCCc-eEEE-------
Confidence 6788888765 4566766531 2 333347888899999998888788888886 8999998832 2222
Q ss_pred ccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec-CCCeEEEEEcCCCC
Q 018806 189 FLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG-FGGLSILKWSPTGD 267 (350)
Q Consensus 189 ~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~~~v~~~~~sp~g~ 267 (350)
+...- +.|.++..+|+|++++.+... ..+.+.|+.++....+-.. .+-|..+.|+|+++
T Consensus 397 ------------------~e~~l-g~I~av~vs~dGK~~vvaNdr-~el~vididngnv~~idkS~~~lItdf~~~~nsr 456 (668)
T COG4946 397 ------------------IEKDL-GNIEAVKVSPDGKKVVVANDR-FELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSR 456 (668)
T ss_pred ------------------eeCCc-cceEEEEEcCCCcEEEEEcCc-eEEEEEEecCCCeeEecccccceeEEEEEcCCce
Confidence 22222 689999999999999988777 7999999999987665544 46689999999999
Q ss_pred EEEEEecCC----eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 268 YFFAAKFDG----TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 268 ~l~~~~~d~----~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
++|.+--+| .|+++|+.+++........+.-.+.+|.|||++|..-+
T Consensus 457 ~iAYafP~gy~tq~Iklydm~~~Kiy~vTT~ta~DfsPaFD~d~ryLYfLs 507 (668)
T COG4946 457 WIAYAFPEGYYTQSIKLYDMDGGKIYDVTTPTAYDFSPAFDPDGRYLYFLS 507 (668)
T ss_pred eEEEecCcceeeeeEEEEecCCCeEEEecCCcccccCcccCCCCcEEEEEe
Confidence 999886665 79999999999876666666677889999999998754
No 247
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.25 E-value=1.6e-09 Score=102.40 Aligned_cols=207 Identities=13% Similarity=0.085 Sum_probs=134.6
Q ss_pred cCeeEEEEec-CCCEEEEEECCCeEEEEEccCCCCC---ceeEecC-CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 100 VDLQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGK---DACILTS-DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 100 ~~V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~---~~~~~~~-~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
..|..++.++ ++.++++||.||+|++|+...-.+. .....+. .....+..+...+.+..+++++.||.|++.+++
T Consensus 1049 ~~v~k~a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys~~~sr~~~vt~~~~~~~~Av~t~DG~v~~~~id 1128 (1431)
T KOG1240|consen 1049 SAVIKLAVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGGSARSELTYSPEGSRVEKVTMCGNGDQFAVSTKDGSVRVLRID 1128 (1431)
T ss_pred ccccceeecCCCCceEEEecCCceEEEeeehhhhcCcceeeeeEEEeccCCceEEEEeccCCCeEEEEcCCCeEEEEEcc
Confidence 3566777765 4599999999999999998532221 2222222 256789999999998999999889999999998
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeE-EECCC-CC-eEEEEEeCCCeEEEEeCCCCCceeee
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITAL-SWGPD-GR-YLASASYESSSFTIWDVAQGLGTPIR 251 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~-~~sp~-g~-~l~~~~~d~g~i~iwd~~~~~~~~~~ 251 (350)
.......... +......+..+.+.++ +|... +. .++++... +.|..||++........
T Consensus 1129 ~~~~~~~~~~------------------~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~-~~iv~~D~r~~~~~w~l 1189 (1431)
T KOG1240|consen 1129 HYNVSKRVAT------------------QVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDL-SRIVSWDTRMRHDAWRL 1189 (1431)
T ss_pred ccccccceee------------------eeecccccCCCceEEeecccccccceeEEEEEec-cceEEecchhhhhHHhh
Confidence 4211111000 1111122222344333 34332 23 57777777 69999999987654333
Q ss_pred ---ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec--cccCCCCeEEEEEcCCC---CEEEEEEC-CCeEEEE
Q 018806 252 ---RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP--WSSTSGFVTGATWDPEG---RMILLAFA-GSLTLGS 322 (350)
Q Consensus 252 ---~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~--~~~~~~~v~~~~~s~~g---~~l~~~~~-~~~~~~~ 322 (350)
...+.|++++.+|.+.|++.|...|.+-+||++-+.... ...+..++..+..+|-. ...++++. +...+-.
T Consensus 1190 k~~~~hG~vTSi~idp~~~WlviGts~G~l~lWDLRF~~~i~sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~~~~nevs~ 1269 (1431)
T KOG1240|consen 1190 KNQLRHGLVTSIVIDPWCNWLVIGTSRGQLVLWDLRFRVPILSWEHPARAPIRHVWLCPTYPQESVSVSAGSSSNNEVST 1269 (1431)
T ss_pred hcCccccceeEEEecCCceEEEEecCCceEEEEEeecCceeecccCcccCCcceEEeeccCCCCceEEEecccCCCceee
Confidence 235889999999999999999999999999999877632 22444667777666533 45555543 3344444
Q ss_pred EEe
Q 018806 323 IHF 325 (350)
Q Consensus 323 ~~~ 325 (350)
|.+
T Consensus 1270 wn~ 1272 (1431)
T KOG1240|consen 1270 WNM 1272 (1431)
T ss_pred eec
Confidence 444
No 248
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.23 E-value=1.2e-09 Score=95.51 Aligned_cols=93 Identities=11% Similarity=0.148 Sum_probs=76.2
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-------ecC-----CCeEEEEEcCCCCEEEEEecCCeEEE
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-------RGF-----GGLSILKWSPTGDYFFAAKFDGTFYL 280 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-------~~~-----~~v~~~~~sp~g~~l~~~~~d~~v~i 280 (350)
+.++++..++-...|++|+.+ |.|..||.+........ .+. ..|+++.|+-+|-.+++|..+|.|.|
T Consensus 176 ~~lN~v~in~~hgLla~Gt~~-g~VEfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~v~i 254 (703)
T KOG2321|consen 176 GELNVVSINEEHGLLACGTED-GVVEFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGSVLI 254 (703)
T ss_pred ccceeeeecCccceEEecccC-ceEEEecchhhhhheeeecccccCCCccccccCcceEEEecCCceeEEeeccCCcEEE
Confidence 689999999998899999988 79999999887543322 122 23899999999999999999999999
Q ss_pred EeCCCCceeccccC--CCCeEEEEEcCC
Q 018806 281 WETNTWTSEPWSST--SGFVTGATWDPE 306 (350)
Q Consensus 281 wd~~~~~~~~~~~~--~~~v~~~~~s~~ 306 (350)
||+++.+..-...| .-+|..+.|.+.
T Consensus 255 yDLRa~~pl~~kdh~~e~pi~~l~~~~~ 282 (703)
T KOG2321|consen 255 YDLRASKPLLVKDHGYELPIKKLDWQDT 282 (703)
T ss_pred EEcccCCceeecccCCccceeeeccccc
Confidence 99999988666655 447888999775
No 249
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=99.21 E-value=2.3e-10 Score=106.17 Aligned_cols=154 Identities=13% Similarity=0.062 Sum_probs=124.8
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
..-+.++++.-++++|+.-+.|.+|++.. +... . ...+|.+.|.++.|+.||.++++++.|+++++|+++..+...
T Consensus 136 ~~~~g~s~~~~~i~~gsv~~~iivW~~~~-dn~p-~-~l~GHeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~- 211 (967)
T KOG0974|consen 136 SLIIGDSAEELYIASGSVFGEIIVWKPHE-DNKP-I-RLKGHEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLG- 211 (967)
T ss_pred EEEEeccCcEEEEEeccccccEEEEeccc-cCCc-c-eecccCCceEEEEEccCCcEEEEEecCcceeeeecccccccC-
Confidence 34455677788999999999999999962 2222 2 335899999999999999999999999999999999554432
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC-CCeEEE
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF-GGLSIL 260 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~-~~v~~~ 260 (350)
...-+|. .+++.+.|.|+ .+++++.| -+.++|+.+..+...+.+|. +.+..+
T Consensus 212 -----------------------~~~fgHs-aRvw~~~~~~n--~i~t~ged-ctcrvW~~~~~~l~~y~~h~g~~iw~~ 264 (967)
T KOG0974|consen 212 -----------------------CTGFGHS-ARVWACCFLPN--RIITVGED-CTCRVWGVNGTQLEVYDEHSGKGIWKI 264 (967)
T ss_pred -----------------------ccccccc-ceeEEEEeccc--eeEEeccc-eEEEEEecccceehhhhhhhhcceeEE
Confidence 1234665 79999999998 99999999 59999988766666666665 679999
Q ss_pred EEcCCCCEEEEEecCCeEEEEeCCCC
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWETNTW 286 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~~~~ 286 (350)
+..++..++++++.|+.+++|++...
T Consensus 265 ~~~~~~~~~vT~g~Ds~lk~~~l~~r 290 (967)
T KOG0974|consen 265 AVPIGVIIKVTGGNDSTLKLWDLNGR 290 (967)
T ss_pred EEcCCceEEEeeccCcchhhhhhhcc
Confidence 99999989999999999999998653
No 250
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=99.20 E-value=5.5e-10 Score=91.67 Aligned_cols=207 Identities=14% Similarity=0.201 Sum_probs=130.6
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCC-----CCeeEEEEeeCCC-eEEEEecCCcEEEE
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQ-----RDVKVLEWRPNGG-RSLSVGCKGGICIW 171 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~-----~~v~~~~~sp~~~-~l~~~~~d~~v~iw 171 (350)
+...|.+++++.|+..++++ .|-.|.+|+++..++..-..-.+++. .-|++..|+|.-. .++++++.|+|++-
T Consensus 163 HtyhiNSIS~NsD~Et~lSA-DdLRINLWnlei~d~sFnIVDIKP~nmEeLteVITsaEFhp~~cn~f~YSSSKGtIrLc 241 (433)
T KOG1354|consen 163 HTYHINSISVNSDKETFLSA-DDLRINLWNLEIIDQSFNIVDIKPANMEELTEVITSAEFHPHHCNVFVYSSSKGTIRLC 241 (433)
T ss_pred ceeEeeeeeecCccceEeec-cceeeeeccccccCCceeEEEccccCHHHHHHHHhhhccCHhHccEEEEecCCCcEEEe
Confidence 34579999999999988874 67789999997544332222222232 3588999999744 45566667999999
Q ss_pred ecCCCCC----CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-C
Q 018806 172 APSYPGN----AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-L 246 (350)
Q Consensus 172 d~~~~~~----~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-~ 246 (350)
|++.... ...+... ..+. . ..-+..- -..|.++.|+++|+++++-..- +|++||++-. +
T Consensus 242 DmR~~aLCd~hsKlfEep-edp~--------~----rsffsei-IsSISDvKFs~sGryilsRDyl--tvk~wD~nme~~ 305 (433)
T KOG1354|consen 242 DMRQSALCDAHSKLFEEP-EDPS--------S----RSFFSEI-ISSISDVKFSHSGRYILSRDYL--TVKLWDLNMEAK 305 (433)
T ss_pred echhhhhhcchhhhhccc-cCCc--------c----hhhHHHH-hhhhhceEEccCCcEEEEeccc--eeEEEeccccCC
Confidence 9982211 1111000 0000 0 0001111 1478899999999999987665 8999998532 2
Q ss_pred c-eeeeecC------------CC---eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc------------------
Q 018806 247 G-TPIRRGF------------GG---LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS------------------ 292 (350)
Q Consensus 247 ~-~~~~~~~------------~~---v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~------------------ 292 (350)
. ....-|. .. -..++|+-++.++++|+..+.+++|+...|......
T Consensus 306 pv~t~~vh~~lr~kLc~lYEnD~IfdKFec~~sg~~~~v~TGsy~n~frvf~~~~gsk~d~tl~asr~~~~~~~~~k~~~ 385 (433)
T KOG1354|consen 306 PVETYPVHEYLRSKLCSLYENDAIFDKFECSWSGNDSYVMTGSYNNVFRVFNLARGSKEDFTLEASRKNMKPRKVLKLRL 385 (433)
T ss_pred cceEEeehHhHHHHHHHHhhccchhheeEEEEcCCcceEecccccceEEEecCCCCcceeecccccccCCccccccccee
Confidence 2 2222221 22 246899999999999999999999996654431110
Q ss_pred ---c--------------CCCCeEEEEEcCCCCEEEEEECCCeEEE
Q 018806 293 ---S--------------TSGFVTGATWDPEGRMILLAFAGSLTLG 321 (350)
Q Consensus 293 ---~--------------~~~~v~~~~~s~~g~~l~~~~~~~~~~~ 321 (350)
+ ....+...+|+|....+|++..+..+++
T Consensus 386 V~~~g~r~~~~~~vd~ldf~kkilh~aWhp~en~ia~aatnnlyif 431 (433)
T KOG1354|consen 386 VSSSGKRKRDEISVDALDFRKKILHTAWHPKENSIAVAATNNLYIF 431 (433)
T ss_pred eecCCCccccccccchhhhhhHHHhhccCCccceeeeeecCceEEe
Confidence 0 0113456788998888888876555543
No 251
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=99.19 E-value=3.1e-08 Score=85.15 Aligned_cols=217 Identities=9% Similarity=0.022 Sum_probs=135.4
Q ss_pred EecCCCEEEEEEC----------CCeEEEEEccCCCCCceeEecCCC------CCCeeEEEEeeCCCeEEEEe-c-CCcE
Q 018806 107 WHQHKHIVAFISG----------STQVIVRDYEDSEGKDACILTSDS------QRDVKVLEWRPNGGRSLSVG-C-KGGI 168 (350)
Q Consensus 107 ~sp~g~~la~~s~----------d~~i~iw~~~~~~~~~~~~~~~~~------~~~v~~~~~sp~~~~l~~~~-~-d~~v 168 (350)
+||||+.|+.+.. +..|.+||..+ .+....+..+. ...-..++++|||++++... . +..|
T Consensus 53 ~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t--~~~~~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n~~p~~~V 130 (352)
T TIGR02658 53 VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQT--HLPIADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQFSPSPAV 130 (352)
T ss_pred ECCCCCEEEEEeccccccccCCCCCEEEEEECcc--CcEEeEEccCCCchhhccCccceEEECCCCCEEEEecCCCCCEE
Confidence 8999998888765 78899999954 55555554321 12334789999988887666 3 5999
Q ss_pred EEEecCCCCCCceeeccccccc------ceecCCCCCceEEe----------ee---ccCCCCCce-eeEEECC-CCCeE
Q 018806 169 CIWAPSYPGNAASVRSGAASFL------GALSRGPGTRWTLV----------DF---LRSQNGEQI-TALSWGP-DGRYL 227 (350)
Q Consensus 169 ~iwd~~~~~~~~~~~~~~~~~~------~~~~~~~~~~~~~~----------~~---~~~~~~~~v-~~~~~sp-~g~~l 227 (350)
.+.|+...+....+........ ..+..+.|+.+... .. +.+.. ..+ ..-.|.+ +|+++
T Consensus 131 ~VvD~~~~kvv~ei~vp~~~~vy~t~e~~~~~~~~Dg~~~~v~~d~~g~~~~~~~~vf~~~~-~~v~~rP~~~~~dg~~~ 209 (352)
T TIGR02658 131 GVVDLEGKAFVRMMDVPDCYHIFPTANDTFFMHCRDGSLAKVGYGTKGNPKIKPTEVFHPED-EYLINHPAYSNKSGRLV 209 (352)
T ss_pred EEEECCCCcEEEEEeCCCCcEEEEecCCccEEEeecCceEEEEecCCCceEEeeeeeecCCc-cccccCCceEcCCCcEE
Confidence 9999997766655544321111 11222333332221 11 11100 000 0113455 77666
Q ss_pred EEEEeCCCeEEEEeCCCCCc-----eeeee--------cCCCeEEEEEcCCCCEEEEEec----------CCeEEEEeCC
Q 018806 228 ASASYESSSFTIWDVAQGLG-----TPIRR--------GFGGLSILKWSPTGDYFFAAKF----------DGTFYLWETN 284 (350)
Q Consensus 228 ~~~~~d~g~i~iwd~~~~~~-----~~~~~--------~~~~v~~~~~sp~g~~l~~~~~----------d~~v~iwd~~ 284 (350)
..+. . |+|.+.|+..... ..+.. ..+...-++++|+|+.+++... .+.|.++|..
T Consensus 210 ~vs~-e-G~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~ 287 (352)
T TIGR02658 210 WPTY-T-GKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAK 287 (352)
T ss_pred EEec-C-CeEEEEecCCCcceecceeeeccccccccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECC
Confidence 6554 4 6999999654322 11111 1234455999999999877431 2579999999
Q ss_pred CCceeccccCCCCeEEEEEcCCCC-EEEEEECCCeEEEEEEeCCC
Q 018806 285 TWTSEPWSSTSGFVTGATWDPEGR-MILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 285 ~~~~~~~~~~~~~v~~~~~s~~g~-~l~~~~~~~~~~~~~~~~~~ 328 (350)
+++..........+..++++|||+ +|+++......+..++....
T Consensus 288 t~kvi~~i~vG~~~~~iavS~Dgkp~lyvtn~~s~~VsViD~~t~ 332 (352)
T TIGR02658 288 TGKRLRKIELGHEIDSINVSQDAKPLLYALSTGDKTLYIFDAETG 332 (352)
T ss_pred CCeEEEEEeCCCceeeEEECCCCCeEEEEeCCCCCcEEEEECcCC
Confidence 999876665667899999999999 77766645556666665543
No 252
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=99.19 E-value=1.2e-09 Score=95.36 Aligned_cols=191 Identities=14% Similarity=0.197 Sum_probs=131.2
Q ss_pred eEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCcee
Q 018806 103 QGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASV 182 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~ 182 (350)
..++++.-..-|++++....|+=+++ .+|..+.-+. -..+.++++..++..+.+++++.+|.|..||.+.......+
T Consensus 137 RDm~y~~~scDly~~gsg~evYRlNL--EqGrfL~P~~-~~~~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l 213 (703)
T KOG2321|consen 137 RDMKYHKPSCDLYLVGSGSEVYRLNL--EQGRFLNPFE-TDSGELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTL 213 (703)
T ss_pred ccccccCCCccEEEeecCcceEEEEc--cccccccccc-cccccceeeeecCccceEEecccCceEEEecchhhhhheee
Confidence 34555533333444444444544455 4566555442 34478999999998444444444899999999865554443
Q ss_pred ecccccccceecCCCCCceEEeeeccCCC----CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC--CC
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDFLRSQN----GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF--GG 256 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~----~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~--~~ 256 (350)
.... .+..|. ...|+++.|+.+|-.+++|+.. |.+.|||+++.++..+..|. -+
T Consensus 214 ~~~~-------------------~v~s~pg~~~~~svTal~F~d~gL~~aVGts~-G~v~iyDLRa~~pl~~kdh~~e~p 273 (703)
T KOG2321|consen 214 DAAS-------------------SVNSHPGGDAAPSVTALKFRDDGLHVAVGTST-GSVLIYDLRASKPLLVKDHGYELP 273 (703)
T ss_pred eccc-------------------ccCCCccccccCcceEEEecCCceeEEeeccC-CcEEEEEcccCCceeecccCCccc
Confidence 3221 111111 1359999999999999999999 89999999999888777765 56
Q ss_pred eEEEEEcCCCCE-EEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 257 LSILKWSPTGDY-FFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 257 v~~~~~sp~g~~-l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
|..+.|.+.+.. -+.......++|||-.+|+..........+..+++-|++-+++++.+.
T Consensus 274 i~~l~~~~~~~q~~v~S~Dk~~~kiWd~~~Gk~~asiEpt~~lND~C~~p~sGm~f~Ane~ 334 (703)
T KOG2321|consen 274 IKKLDWQDTDQQNKVVSMDKRILKIWDECTGKPMASIEPTSDLNDFCFVPGSGMFFTANES 334 (703)
T ss_pred eeeecccccCCCceEEecchHHhhhcccccCCceeeccccCCcCceeeecCCceEEEecCC
Confidence 888999876333 233334568999999999986666556679999999999999988744
No 253
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=99.16 E-value=5.9e-10 Score=95.41 Aligned_cols=221 Identities=14% Similarity=0.191 Sum_probs=144.6
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC--CCeEEEEecCCcEEEEecCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN--GGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
.-|..|.|+..|..|++++.|..|.+||+.. ++....+..+|...|....|-|. .+.++.++.||.+++-.+...+
T Consensus 143 GcVntV~FN~~Gd~l~SgSDD~~vv~WdW~~--~~~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~s~i~~t~ 220 (559)
T KOG1334|consen 143 GCVNTVHFNQRGDVLASGSDDLQVVVWDWVS--GSPKLSFESGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRVSEILETG 220 (559)
T ss_pred CccceeeecccCceeeccCccceEEeehhhc--cCcccccccccccchhhhhccCCCCCcCceeccccCceeeeeecccc
Confidence 4699999999999999999999999999964 55556666689999988888775 3578888888988877665322
Q ss_pred CCceeecc--cccccce-------------------------------------------------ecCCCC--------
Q 018806 178 NAASVRSG--AASFLGA-------------------------------------------------LSRGPG-------- 198 (350)
Q Consensus 178 ~~~~~~~~--~~~~~~~-------------------------------------------------~~~~~~-------- 198 (350)
........ ...++.. ++..+.
T Consensus 221 ~~e~t~rl~~h~g~vhklav~p~sp~~f~S~geD~~v~~~Dlr~~~pa~~~~cr~~~~~~~v~L~~Ia~~P~nt~~faVg 300 (559)
T KOG1334|consen 221 YVENTKRLAPHEGPVHKLAVEPDSPKPFLSCGEDAVVFHIDLRQDVPAEKFVCREADEKERVGLYTIAVDPRNTNEFAVG 300 (559)
T ss_pred ceecceecccccCccceeeecCCCCCcccccccccceeeeeeccCCccceeeeeccCCccceeeeeEecCCCCccccccC
Confidence 22211000 0000000 000000
Q ss_pred --CceE---------------Eeeec-----cCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc---------
Q 018806 199 --TRWT---------------LVDFL-----RSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG--------- 247 (350)
Q Consensus 199 --~~~~---------------~~~~~-----~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~--------- 247 (350)
+.+. .++.+ .......|++++|+.++.-|+++-.|. .|+++.-.-+..
T Consensus 301 G~dqf~RvYD~R~~~~e~~n~~~~~f~p~hl~~d~~v~ITgl~Ysh~~sElLaSYnDe-~IYLF~~~~~~G~~p~~~s~~ 379 (559)
T KOG1334|consen 301 GSDQFARVYDQRRIDKEENNGVLDKFCPHHLVEDDPVNITGLVYSHDGSELLASYNDE-DIYLFNKSMGDGSEPDPSSPR 379 (559)
T ss_pred ChhhhhhhhcccchhhccccchhhhcCCccccccCcccceeEEecCCccceeeeeccc-ceEEeccccccCCCCCCCcch
Confidence 0000 00111 111134689999998877777777774 899995332211
Q ss_pred ----ee-eeecC--CCeEEEEE-cCCCCEEEEEecCCeEEEEeCCCCceeccc-cCCCCeEEEEEcCCCCEEEEEECCCe
Q 018806 248 ----TP-IRRGF--GGLSILKW-SPTGDYFFAAKFDGTFYLWETNTWTSEPWS-STSGFVTGATWDPEGRMILLAFAGSL 318 (350)
Q Consensus 248 ----~~-~~~~~--~~v~~~~~-sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-~~~~~v~~~~~s~~g~~l~~~~~~~~ 318 (350)
.. ..+|. ..|..+-| -|...++++|+.-|.|.||+-.+++...+. +....|.++.=+|--..||+++
T Consensus 380 ~~~~k~vYKGHrN~~TVKgVNFfGPrsEyVvSGSDCGhIFiW~K~t~eii~~MegDr~VVNCLEpHP~~PvLAsSG---- 455 (559)
T KOG1334|consen 380 EQYVKRVYKGHRNSRTVKGVNFFGPRSEYVVSGSDCGHIFIWDKKTGEIIRFMEGDRHVVNCLEPHPHLPVLASSG---- 455 (559)
T ss_pred hhccchhhcccccccccceeeeccCccceEEecCccceEEEEecchhHHHHHhhcccceEeccCCCCCCchhhccC----
Confidence 11 33443 33666664 688999999999999999999999986544 4455889999999999999874
Q ss_pred EEEEEEeCC
Q 018806 319 TLGSIHFAS 327 (350)
Q Consensus 319 ~~~~~~~~~ 327 (350)
....+++|.
T Consensus 456 id~DVKIWT 464 (559)
T KOG1334|consen 456 IDHDVKIWT 464 (559)
T ss_pred Cccceeeec
Confidence 455555554
No 254
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=99.13 E-value=3e-09 Score=98.92 Aligned_cols=177 Identities=15% Similarity=0.159 Sum_probs=128.1
Q ss_pred EEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCe-----eEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 105 VSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDV-----KVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 105 v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v-----~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..+.-+...++.+..+..+.+||... +.....+ .+...+ .-+-++++.-++++++.-+.+.+|+......+
T Consensus 93 ~~l~~e~k~i~l~~~~ns~~i~d~~~--~~~~~~i--~~~er~~l~~~~~~g~s~~~~~i~~gsv~~~iivW~~~~dn~p 168 (967)
T KOG0974|consen 93 AKLFEENKKIALVTSRNSLLIRDSKN--SSVLSKI--QSDERCTLYSSLIIGDSAEELYIASGSVFGEIIVWKPHEDNKP 168 (967)
T ss_pred cchhhhcceEEEEEcCceEEEEeccc--Cceehhc--CCCceEEEEeEEEEeccCcEEEEEeccccccEEEEeccccCCc
Confidence 34444667888889999999999842 3333322 232221 12233555223334444699999998732221
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--eeeecCCCe
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--PIRRGFGGL 257 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~~~~~~~~v 257 (350)
. .+.+|. +.+.++.|+-||+++++.++|. ++++|++.+.+.. ..++|...+
T Consensus 169 ~-------------------------~l~GHe-G~iF~i~~s~dg~~i~s~SdDR-siRlW~i~s~~~~~~~~fgHsaRv 221 (967)
T KOG0974|consen 169 I-------------------------RLKGHE-GSIFSIVTSLDGRYIASVSDDR-SIRLWPIDSREVLGCTGFGHSARV 221 (967)
T ss_pred c-------------------------eecccC-CceEEEEEccCCcEEEEEecCc-ceeeeecccccccCccccccccee
Confidence 1 367775 8999999999999999999995 9999999998754 466889999
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccC-CCCeEEEEEcCCCCEEEEEE
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSST-SGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~-~~~v~~~~~s~~g~~l~~~~ 314 (350)
..++|.|+ .+++++.|.+.++|+.+..+...+..| ...++.++..++...+++++
T Consensus 222 w~~~~~~n--~i~t~gedctcrvW~~~~~~l~~y~~h~g~~iw~~~~~~~~~~~vT~g 277 (967)
T KOG0974|consen 222 WACCFLPN--RIITVGEDCTCRVWGVNGTQLEVYDEHSGKGIWKIAVPIGVIIKVTGG 277 (967)
T ss_pred EEEEeccc--eeEEeccceEEEEEecccceehhhhhhhhcceeEEEEcCCceEEEeec
Confidence 99999999 899999999999997776655555555 34689999988777777664
No 255
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=99.12 E-value=7.6e-09 Score=90.24 Aligned_cols=169 Identities=15% Similarity=0.303 Sum_probs=111.0
Q ss_pred eEEEEecCCCEE-EEEEC-----------CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec--CCcE
Q 018806 103 QGVSWHQHKHIV-AFISG-----------STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC--KGGI 168 (350)
Q Consensus 103 ~~v~~sp~g~~l-a~~s~-----------d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~--d~~v 168 (350)
-.+.|++-|+-| +.++. +.++++++++ +.. +.......++|.++.|+|+++.++++-. -.++
T Consensus 221 vqm~WN~~gt~LLvLastdVDktn~SYYGEq~Lyll~t~---g~s-~~V~L~k~GPVhdv~W~~s~~EF~VvyGfMPAkv 296 (566)
T KOG2315|consen 221 VQMKWNKLGTALLVLASTDVDKTNASYYGEQTLYLLATQ---GES-VSVPLLKEGPVHDVTWSPSGREFAVVYGFMPAKV 296 (566)
T ss_pred eEEEeccCCceEEEEEEEeecCCCccccccceEEEEEec---Cce-EEEecCCCCCceEEEECCCCCEEEEEEecccceE
Confidence 457788877533 22221 2356666664 222 3332346789999999999887766554 3889
Q ss_pred EEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC--CeEEEEeCCCCC
Q 018806 169 CIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES--SSFTIWDVAQGL 246 (350)
Q Consensus 169 ~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--g~i~iwd~~~~~ 246 (350)
.|+|++. ..... + ..++-.++-|+|.|++|+.++.++ |.|.+||+.+.+
T Consensus 297 tifnlr~-~~v~d-------------------------f---~egpRN~~~fnp~g~ii~lAGFGNL~G~mEvwDv~n~K 347 (566)
T KOG2315|consen 297 TIFNLRG-KPVFD-------------------------F---PEGPRNTAFFNPHGNIILLAGFGNLPGDMEVWDVPNRK 347 (566)
T ss_pred EEEcCCC-CEeEe-------------------------C---CCCCccceEECCCCCEEEEeecCCCCCceEEEeccchh
Confidence 9999872 11100 1 124667899999999999887764 799999999865
Q ss_pred ceeeeecCCCeEEEEEcCCCCEEEEEec------CCeEEEEeCCCCceeccccCCCCeEEEEEcCC
Q 018806 247 GTPIRRGFGGLSILKWSPTGDYFFAAKF------DGTFYLWETNTWTSEPWSSTSGFVTGATWDPE 306 (350)
Q Consensus 247 ~~~~~~~~~~v~~~~~sp~g~~l~~~~~------d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~ 306 (350)
++.... ....+-+.|+|||++++++.. |+.++||++........ ......+.+.|-|.
T Consensus 348 ~i~~~~-a~~tt~~eW~PdGe~flTATTaPRlrvdNg~KiwhytG~~l~~~-~f~sEL~qv~W~P~ 411 (566)
T KOG2315|consen 348 LIAKFK-AANTTVFEWSPDGEYFLTATTAPRLRVDNGIKIWHYTGSLLHEK-MFKSELLQVEWRPF 411 (566)
T ss_pred hccccc-cCCceEEEEcCCCcEEEEEeccccEEecCCeEEEEecCceeehh-hhhHhHhheeeeec
Confidence 543322 234455899999999988754 68899999975443211 11115667777753
No 256
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=99.10 E-value=4.3e-09 Score=99.57 Aligned_cols=196 Identities=14% Similarity=0.125 Sum_probs=125.6
Q ss_pred CCceeEecCCCCCCeeEEEEeeCC-CeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCC
Q 018806 133 GKDACILTSDSQRDVKVLEWRPNG-GRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN 211 (350)
Q Consensus 133 ~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 211 (350)
|..+..+ ..|...+..++.++.. ..+++++.||+|++|+...-..-.. ..+...++...
T Consensus 1038 G~lVAhL-~Ehs~~v~k~a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~------------------s~rS~ltys~~- 1097 (1431)
T KOG1240|consen 1038 GILVAHL-HEHSSAVIKLAVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGG------------------SARSELTYSPE- 1097 (1431)
T ss_pred ceEeehh-hhccccccceeecCCCCceEEEecCCceEEEeeehhhhcCcc------------------eeeeeEEEecc-
Confidence 5544444 4688888888887764 6677777789999999973221100 11122222222
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC--ce-----eeee--cCCCeE-EEEEcC-CCC-EEEEEecCCeEE
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGL--GT-----PIRR--GFGGLS-ILKWSP-TGD-YFFAAKFDGTFY 279 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~--~~-----~~~~--~~~~v~-~~~~sp-~g~-~l~~~~~d~~v~ 279 (350)
...+..+...+.+..+|+++.| |.|.+.+++... .. .+.. ..+.+. .-+|.. .+. .|+.+..-+.|.
T Consensus 1098 ~sr~~~vt~~~~~~~~Av~t~D-G~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv 1176 (1431)
T KOG1240|consen 1098 GSRVEKVTMCGNGDQFAVSTKD-GSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIV 1176 (1431)
T ss_pred CCceEEEEeccCCCeEEEEcCC-CeEEEEEccccccccceeeeeecccccCCCceEEeecccccccceeEEEEEeccceE
Confidence 3689999999999999999999 899999987621 11 1111 123333 334433 333 677888889999
Q ss_pred EEeCCCCcee---ccccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEeCCCCCCCc-eeecccccceeecccC
Q 018806 280 LWETNTWTSE---PWSSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHFASKPPSLD-AHLLPVDLPDIVSLTG 349 (350)
Q Consensus 280 iwd~~~~~~~---~~~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~~~~~~~~~-~~~~~v~~~~~~~~~g 349 (350)
.||+++.... +.....+.|++++.+|.+.+++.|. .|...+|++++.-....+. .+..+++..+...+.+
T Consensus 1177 ~~D~r~~~~~w~lk~~~~hG~vTSi~idp~~~WlviGts~G~l~lWDLRF~~~i~sw~~P~~~~i~~v~~~~~~~ 1251 (1431)
T KOG1240|consen 1177 SWDTRMRHDAWRLKNQLRHGLVTSIVIDPWCNWLVIGTSRGQLVLWDLRFRVPILSWEHPARAPIRHVWLCPTYP 1251 (1431)
T ss_pred EecchhhhhHHhhhcCccccceeEEEecCCceEEEEecCCceEEEEEeecCceeecccCcccCCcceEEeeccCC
Confidence 9999886652 3334457899999999999999998 4446677777654332221 2335555555544433
No 257
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=99.09 E-value=3e-08 Score=79.06 Aligned_cols=186 Identities=11% Similarity=0.074 Sum_probs=123.5
Q ss_pred EEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccccccccee
Q 018806 114 VAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGAL 193 (350)
Q Consensus 114 la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~ 193 (350)
+..++.|.++++.+++....+..... . .-.+.+++.++|++.+++++....|..|.++....
T Consensus 131 ~~i~sndht~k~~~~~~~s~~~~~h~--~-~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~se--------------- 192 (344)
T KOG4532|consen 131 LNIASNDHTGKTMVVSGDSNKFAVHN--Q-NLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESE--------------- 192 (344)
T ss_pred eeeccCCcceeEEEEecCcccceeec--c-ccceeeeEEcCCCceEEEecCCCcceEEEeCCccc---------------
Confidence 45568999999999875332221111 1 13488999999988888888889999998873321
Q ss_pred cCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee------eeecCCCeEEEEEcCCCC
Q 018806 194 SRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP------IRRGFGGLSILKWSPTGD 267 (350)
Q Consensus 194 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~------~~~~~~~v~~~~~sp~g~ 267 (350)
.+.+.........-.+.+|+.....+|++..| |++.|||++...... ...|.+.+..+.|++-|.
T Consensus 193 --------y~~~~~~a~t~D~gF~~S~s~~~~~FAv~~Qd-g~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~ 263 (344)
T KOG4532|consen 193 --------YIENIYEAPTSDHGFYNSFSENDLQFAVVFQD-GTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGL 263 (344)
T ss_pred --------eeeeeEecccCCCceeeeeccCcceEEEEecC-CcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCc
Confidence 11121111122344678999999999999999 799999999754321 123678999999998664
Q ss_pred --EEEEEecCCeEEEEeCCCCceeccc--------cCC-CCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 268 --YFFAAKFDGTFYLWETNTWTSEPWS--------STS-GFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 268 --~l~~~~~d~~v~iwd~~~~~~~~~~--------~~~-~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
+|+..-.-+.+++.|+++++..+.. .|. ..|..-.|+.++..+.+.... .+++|.+..+
T Consensus 264 lDLLf~sEhfs~~hv~D~R~~~~~q~I~i~~d~~~~~~tq~ifgt~f~~~n~s~~v~~e~--~~ae~ni~sr 333 (344)
T KOG4532|consen 264 LDLLFISEHFSRVHVVDTRNYVNHQVIVIPDDVERKHNTQHIFGTNFNNENESNDVKNEL--QGAEYNILSR 333 (344)
T ss_pred ceEEEEecCcceEEEEEcccCceeeEEecCccccccccccccccccccCCCcccccccch--hhheeecccc
Confidence 3455555678999999998763321 232 237777888888777666433 3445555443
No 258
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=99.09 E-value=4.2e-08 Score=79.18 Aligned_cols=168 Identities=16% Similarity=0.273 Sum_probs=107.4
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCC------CCCCeeEEEEeeC------CCeEEEEecCCcE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSD------SQRDVKVLEWRPN------GGRSLSVGCKGGI 168 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~------~~~~v~~~~~sp~------~~~l~~~~~d~~v 168 (350)
.-+-++||||+..||.+...|+|+++|+. +.....+... -...|..+.|.+. ...|++...+|.+
T Consensus 45 QWRkl~WSpD~tlLa~a~S~G~i~vfdl~---g~~lf~I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L 121 (282)
T PF15492_consen 45 QWRKLAWSPDCTLLAYAESTGTIRVFDLM---GSELFVIPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQL 121 (282)
T ss_pred hheEEEECCCCcEEEEEcCCCeEEEEecc---cceeEEcCcccccCCccccceeeeEeeccccccccceeEEEEecccee
Confidence 36789999999999999999999999985 3333333222 2345666767543 1246666667777
Q ss_pred EEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC----------eEE
Q 018806 169 CIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS----------SFT 238 (350)
Q Consensus 169 ~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g----------~i~ 238 (350)
+-|-+..+....-... ..-.+..|....|.++.++|..+.|+.++.... -+.
T Consensus 122 ~Sy~vs~gt~q~y~e~------------------hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLt 183 (282)
T PF15492_consen 122 RSYLVSVGTNQGYQEN------------------HSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLT 183 (282)
T ss_pred eeEEEEcccCCcceee------------------EEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCccccccccCce
Confidence 6666532211111000 112244444568999999998888887754321 134
Q ss_pred EEeCCCCCc---------------------ee-----ee----ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 239 IWDVAQGLG---------------------TP-----IR----RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 239 iwd~~~~~~---------------------~~-----~~----~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
.|.+-++.+ .. +. .....|..+..||||+.||+...+|.|.+|++.+-+.
T Consensus 184 aWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSlSPdg~~La~ih~sG~lsLW~iPsL~~ 263 (282)
T PF15492_consen 184 AWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSLSPDGSLLACIHFSGSLSLWEIPSLRL 263 (282)
T ss_pred EEEEcCCCCcEEEccccCccccccccccceeeccceeeeeccccCCCceEEEEECCCCCEEEEEEcCCeEEEEecCcchh
Confidence 454332200 00 10 1246789999999999999999999999999988766
Q ss_pred e
Q 018806 289 E 289 (350)
Q Consensus 289 ~ 289 (350)
+
T Consensus 264 ~ 264 (282)
T PF15492_consen 264 Q 264 (282)
T ss_pred h
Confidence 3
No 259
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=99.08 E-value=6e-08 Score=84.78 Aligned_cols=202 Identities=18% Similarity=0.277 Sum_probs=123.6
Q ss_pred CCCccCeeEEEEecCC--CEEEE-----EECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEe-c--C
Q 018806 96 LLPEVDLQGVSWHQHK--HIVAF-----ISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVG-C--K 165 (350)
Q Consensus 96 ~~~~~~V~~v~~sp~g--~~la~-----~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~-~--d 165 (350)
.++...++.+++||.+ ..+|+ .+.-..++||.+.............-....=-.+.|++-|.-|+... . |
T Consensus 162 kl~~~~i~~f~lSpgp~~~~vAvyvPe~kGaPa~vri~~~~~~~~~~~~a~ksFFkadkvqm~WN~~gt~LLvLastdVD 241 (566)
T KOG2315|consen 162 KLSVSGITMLSLSPGPEPPFVAVYVPEKKGAPASVRIYKYPEEGQHQPVANKSFFKADKVQMKWNKLGTALLVLASTDVD 241 (566)
T ss_pred eeeccceeeEEecCCCCCceEEEEccCCCCCCcEEEEeccccccccchhhhccccccceeEEEeccCCceEEEEEEEeec
Confidence 3344578999999874 45555 34556899998752111100000000112234578888776555432 2 2
Q ss_pred C---------cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEE--EEeCC
Q 018806 166 G---------GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLAS--ASYES 234 (350)
Q Consensus 166 ~---------~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~--~~~d~ 234 (350)
. ++++.++. +....+ .+. ..++|.++.|+|+|+.++. |-+-.
T Consensus 242 ktn~SYYGEq~Lyll~t~--g~s~~V-----------------------~L~--k~GPVhdv~W~~s~~EF~VvyGfMPA 294 (566)
T KOG2315|consen 242 KTNASYYGEQTLYLLATQ--GESVSV-----------------------PLL--KEGPVHDVTWSPSGREFAVVYGFMPA 294 (566)
T ss_pred CCCccccccceEEEEEec--CceEEE-----------------------ecC--CCCCceEEEECCCCCEEEEEEecccc
Confidence 2 35555554 221111 122 2479999999999987664 44553
Q ss_pred CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC---CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEE
Q 018806 235 SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD---GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMIL 311 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~ 311 (350)
++.|||++..- ...-..++-.++-|+|.|++|+.++.+ |.|-|||+.+.++....... .-+-+.|+|||++++
T Consensus 295 -kvtifnlr~~~--v~df~egpRN~~~fnp~g~ii~lAGFGNL~G~mEvwDv~n~K~i~~~~a~-~tt~~eW~PdGe~fl 370 (566)
T KOG2315|consen 295 -KVTIFNLRGKP--VFDFPEGPRNTAFFNPHGNIILLAGFGNLPGDMEVWDVPNRKLIAKFKAA-NTTVFEWSPDGEYFL 370 (566)
T ss_pred -eEEEEcCCCCE--eEeCCCCCccceEECCCCCEEEEeecCCCCCceEEEeccchhhccccccC-CceEEEEcCCCcEEE
Confidence 89999987431 122245677789999999999877664 79999999997764433222 235579999999999
Q ss_pred EEECC-----CeEEEEEEeCCC
Q 018806 312 LAFAG-----SLTLGSIHFASK 328 (350)
Q Consensus 312 ~~~~~-----~~~~~~~~~~~~ 328 (350)
++... +..+..|++.+.
T Consensus 371 TATTaPRlrvdNg~KiwhytG~ 392 (566)
T KOG2315|consen 371 TATTAPRLRVDNGIKIWHYTGS 392 (566)
T ss_pred EEeccccEEecCCeEEEEecCc
Confidence 98643 234455555543
No 260
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=99.07 E-value=2.8e-08 Score=89.39 Aligned_cols=225 Identities=13% Similarity=0.182 Sum_probs=142.1
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCc------------eeEecCCCCCCeeEEEEeeCCCeEEEEecCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKD------------ACILTSDSQRDVKVLEWRPNGGRSLSVGCKG 166 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~------------~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~ 166 (350)
.....|++|+....+||+|+.||.+++..+++.+... ..+...+|...|..+.|+.+.+.+-++..+|
T Consensus 14 nvkL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt~G 93 (1189)
T KOG2041|consen 14 NVKLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDTSG 93 (1189)
T ss_pred CceEEEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCCCc
Confidence 4468999999999999999999999999886532211 1123358999999999998877777777789
Q ss_pred cEEEEecCCCCCCceee-cccccccceecCCCCCceEEe---------eeccCCC-------CCceeeEEECCCCCeEEE
Q 018806 167 GICIWAPSYPGNAASVR-SGAASFLGALSRGPGTRWTLV---------DFLRSQN-------GEQITALSWGPDGRYLAS 229 (350)
Q Consensus 167 ~v~iwd~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~---------~~~~~~~-------~~~v~~~~~sp~g~~l~~ 229 (350)
-|.+|-+-.+.-...+. ....+.+.++++..++.-.++ .++.|.. ......+.|++|.+.++.
T Consensus 94 lIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsvdGNRIwgKeLkg~~l~hv~ws~D~~~~Lf 173 (1189)
T KOG2041|consen 94 LIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSVDGNRIWGKELKGQLLAHVLWSEDLEQALF 173 (1189)
T ss_pred eEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEeeccceecchhcchheccceeecccHHHHHh
Confidence 99999886433222221 222233344444444432221 1111110 113356788888777776
Q ss_pred EEeCCCeEEEEeCCCCC--------------------------------------------------ceeee--------
Q 018806 230 ASYESSSFTIWDVAQGL--------------------------------------------------GTPIR-------- 251 (350)
Q Consensus 230 ~~~d~g~i~iwd~~~~~--------------------------------------------------~~~~~-------- 251 (350)
+-.. |.+.+||....- ...+.
T Consensus 174 ~~an-ge~hlydnqgnF~~Kl~~~c~Vn~tg~~s~~~~kia~i~w~~g~~~~v~pdrP~lavcy~nGr~QiMR~eND~~P 252 (1189)
T KOG2041|consen 174 KKAN-GETHLYDNQGNFERKLEKDCEVNGTGIFSNFPTKIAEIEWNTGPYQPVPPDRPRLAVCYANGRMQIMRSENDPEP 252 (1189)
T ss_pred hhcC-CcEEEecccccHHHhhhhceEEeeeeeecCCCccccceeeccCccccCCCCCCEEEEEEcCceehhhhhcCCCCC
Confidence 6666 677777754320 00000
Q ss_pred ---ecCCCeEEEEEcCCCCEEEEEecC---------CeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeE
Q 018806 252 ---RGFGGLSILKWSPTGDYFFAAKFD---------GTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLT 319 (350)
Q Consensus 252 ---~~~~~v~~~~~sp~g~~l~~~~~d---------~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~ 319 (350)
...-.+....|+++|..||+++.+ +.|++|..-..-...+......|++++|-..|-.++.+.++-++
T Consensus 253 vv~dtgm~~vgakWnh~G~vLAvcG~~~da~~~~d~n~v~Fysp~G~i~gtlkvpg~~It~lsWEg~gLriA~Avdsfiy 332 (1189)
T KOG2041|consen 253 VVVDTGMKIVGAKWNHNGAVLAVCGNDSDADEPTDSNKVHFYSPYGHIVGTLKVPGSCITGLSWEGTGLRIAIAVDSFIY 332 (1189)
T ss_pred eEEecccEeecceecCCCcEEEEccCcccccCccccceEEEeccchhheEEEecCCceeeeeEEcCCceEEEEEecceEE
Confidence 001134567899999999888754 25666654433334556667789999999888888888776666
Q ss_pred EEEEE
Q 018806 320 LGSIH 324 (350)
Q Consensus 320 ~~~~~ 324 (350)
...++
T Consensus 333 fanIR 337 (1189)
T KOG2041|consen 333 FANIR 337 (1189)
T ss_pred EEeec
Confidence 65554
No 261
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=99.05 E-value=1.9e-07 Score=92.65 Aligned_cols=211 Identities=15% Similarity=0.118 Sum_probs=127.5
Q ss_pred eeEEEEecCCCEEEEEEC-CCeEEEEEccCCCCCceeEecC-CC---------------CCCeeEEEEeeCCCeEEEEe-
Q 018806 102 LQGVSWHQHKHIVAFISG-STQVIVRDYEDSEGKDACILTS-DS---------------QRDVKVLEWRPNGGRSLSVG- 163 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~-d~~i~iw~~~~~~~~~~~~~~~-~~---------------~~~v~~~~~sp~~~~l~~~~- 163 (350)
...++++++++.|+++.. .+.|+++|+.. +. +..+.. +. -..-..++|+|+++.++++.
T Consensus 626 P~GIavd~~gn~LYVaDt~n~~Ir~id~~~--~~-V~tlag~G~~g~~~~gg~~~~~~~ln~P~gVa~dp~~g~LyVad~ 702 (1057)
T PLN02919 626 PQGLAYNAKKNLLYVADTENHALREIDFVN--ET-VRTLAGNGTKGSDYQGGKKGTSQVLNSPWDVCFEPVNEKVYIAMA 702 (1057)
T ss_pred CcEEEEeCCCCEEEEEeCCCceEEEEecCC--CE-EEEEeccCcccCCCCCChhhhHhhcCCCeEEEEecCCCeEEEEEC
Confidence 578899998887766654 56788888743 21 221110 00 01235799999555555544
Q ss_pred cCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC
Q 018806 164 CKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 164 ~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~ 243 (350)
.++.|++||..... ...+... +.. ...++.. .... .......++++|+|+.|+.+..+++.|++||+.
T Consensus 703 ~~~~I~v~d~~~g~-v~~~~G~-----G~~-~~~~g~~----~~~~-~~~~P~GIavspdG~~LYVADs~n~~Irv~D~~ 770 (1057)
T PLN02919 703 GQHQIWEYNISDGV-TRVFSGD-----GYE-RNLNGSS----GTST-SFAQPSGISLSPDLKELYIADSESSSIRALDLK 770 (1057)
T ss_pred CCCeEEEEECCCCe-EEEEecC-----Ccc-ccCCCCc----cccc-cccCccEEEEeCCCCEEEEEECCCCeEEEEECC
Confidence 46899999986321 1111100 000 0000000 0000 113567899999999777666655699999998
Q ss_pred CCCceeeeec----------------------CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccC-------
Q 018806 244 QGLGTPIRRG----------------------FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSST------- 294 (350)
Q Consensus 244 ~~~~~~~~~~----------------------~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~------- 294 (350)
++....+... -.....++++++|+.+++-..++.|++||..++....+.+.
T Consensus 771 tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs~N~rIrviD~~tg~v~tiaG~G~~G~~d 850 (1057)
T PLN02919 771 TGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADSYNHKIKKLDPATKRVTTLAGTGKAGFKD 850 (1057)
T ss_pred CCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEECCCCEEEEEECCCCeEEEEeccCCcCCCC
Confidence 7653221110 01245889999999888888899999999998876543321
Q ss_pred -------CCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 295 -------SGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 295 -------~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
-.....++++++|+.+ ++......+..|++...
T Consensus 851 G~~~~a~l~~P~GIavd~dG~ly-VaDt~Nn~Irvid~~~~ 890 (1057)
T PLN02919 851 GKALKAQLSEPAGLALGENGRLF-VADTNNSLIRYLDLNKG 890 (1057)
T ss_pred CcccccccCCceEEEEeCCCCEE-EEECCCCEEEEEECCCC
Confidence 1256789999999854 45545557777776543
No 262
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=99.05 E-value=1.5e-09 Score=94.37 Aligned_cols=157 Identities=16% Similarity=0.170 Sum_probs=112.2
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
.+|.+.|+++.|+.+|..|++++.|-.+.|||.-..+....+ -.+|. ..|.++.|
T Consensus 47 ~GH~GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI------------------------~TgHt-aNIFsvKF 101 (758)
T KOG1310|consen 47 TGHTGCVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSI------------------------STGHT-ANIFSVKF 101 (758)
T ss_pred ccccceecceeecCCCCEEeecCCcceEEeecchhcceeeee------------------------ecccc-cceeEEee
Confidence 489999999999999888888888899999998733332222 23555 78999999
Q ss_pred CC--CCCeEEEEEeCCCeEEEEeCCCCCc----------e-eeeecCCCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCC
Q 018806 221 GP--DGRYLASASYESSSFTIWDVAQGLG----------T-PIRRGFGGLSILKWSPTG-DYFFAAKFDGTFYLWETNTW 286 (350)
Q Consensus 221 sp--~g~~l~~~~~d~g~i~iwd~~~~~~----------~-~~~~~~~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~ 286 (350)
-| +.+.++++..|. .|+++|+...+. . ....|...|..++-.|++ ..+-++++||+++-+|++..
T Consensus 102 vP~tnnriv~sgAgDk-~i~lfdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiREp 180 (758)
T KOG1310|consen 102 VPYTNNRIVLSGAGDK-LIKLFDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIREP 180 (758)
T ss_pred eccCCCeEEEeccCcc-eEEEEecccccccccccCccchhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccCC
Confidence 88 467888899995 999999985321 1 122466778888999998 56789999999999999874
Q ss_pred ceec--------cc---cCCCCeEEEEEcCCCCE-EEEEECC-CeEEEEE
Q 018806 287 TSEP--------WS---STSGFVTGATWDPEGRM-ILLAFAG-SLTLGSI 323 (350)
Q Consensus 287 ~~~~--------~~---~~~~~v~~~~~s~~g~~-l~~~~~~-~~~~~~~ 323 (350)
.... +. ..--...++..+|...+ |++|+.+ -..+|+.
T Consensus 181 h~c~p~~~~~~~l~ny~~~lielk~ltisp~rp~~laVGgsdpfarLYD~ 230 (758)
T KOG1310|consen 181 HVCNPDEDCPSILVNYNPQLIELKCLTISPSRPYYLAVGGSDPFARLYDR 230 (758)
T ss_pred ccCCccccccHHHHHhchhhheeeeeeecCCCCceEEecCCCchhhhhhh
Confidence 3211 11 11234578899997655 5555432 2455553
No 263
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=99.04 E-value=1.8e-09 Score=105.56 Aligned_cols=172 Identities=17% Similarity=0.295 Sum_probs=124.1
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.|.++.=+|...+.++|+.||.+++|.+.. ++.++.........|+.+.|+.+|+.+-++..||.+.+|... +.
T Consensus 2210 ~v~r~~sHp~~~~Yltgs~dgsv~~~~w~~--~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~----pk 2283 (2439)
T KOG1064|consen 2210 NVRRMTSHPSDPYYLTGSQDGSVRMFEWGH--GQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGDLSLWQAS----PK 2283 (2439)
T ss_pred ceeeecCCCCCceEEecCCCceEEEEeccC--CCeEEEeeccCcchhhhhhhcccCCceeeeccCCceeecccC----Cc
Confidence 578888889989999999999999999954 555555544445889999999999999999999999999987 11
Q ss_pred eeeccc--------cccccee----cCCC-CCceEEeeec---------cCCCCCceeeEEECCCCCeEEEEEeCCCeEE
Q 018806 181 SVRSGA--------ASFLGAL----SRGP-GTRWTLVDFL---------RSQNGEQITALSWGPDGRYLASASYESSSFT 238 (350)
Q Consensus 181 ~~~~~~--------~~~~~~~----~~~~-~~~~~~~~~~---------~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~ 238 (350)
.+.... +..++++ ..++ +....+|+++ ..| ++.++++++-|..+.|++|+.+ |.|+
T Consensus 2284 ~~~s~qchnk~~~Df~Fi~s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H-~~gaT~l~~~P~~qllisggr~-G~v~ 2361 (2439)
T KOG1064|consen 2284 PYTSWQCHNKALSDFRFIGSLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCH-DGGATVLAYAPKHQLLISGGRK-GEVC 2361 (2439)
T ss_pred ceeccccCCccccceeeeehhhhccccCCCCCcccchhcccCcccceeeeec-CCCceEEEEcCcceEEEecCCc-CcEE
Confidence 121111 1111110 0111 1223334333 344 4789999999999999999999 8999
Q ss_pred EEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee
Q 018806 239 IWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE 289 (350)
Q Consensus 239 iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~ 289 (350)
+||++..+.+..... +. ...++++++..|.++||++......
T Consensus 2362 l~D~rqrql~h~~~~--------~~-~~~~f~~~ss~g~ikIw~~s~~~ll 2403 (2439)
T KOG1064|consen 2362 LFDIRQRQLRHTFQA--------LD-TREYFVTGSSEGNIKIWRLSEFGLL 2403 (2439)
T ss_pred EeehHHHHHHHHhhh--------hh-hhheeeccCcccceEEEEccccchh
Confidence 999987665443221 44 5678999999999999999876553
No 264
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=99.04 E-value=6.7e-08 Score=83.00 Aligned_cols=192 Identities=18% Similarity=0.226 Sum_probs=130.7
Q ss_pred EEecCCCEEEEEECCCeEEEEEccCCCCCceeEecC-C----CC---CCeeEEE-EeeCCCeEEEEecCCcEEEEecCCC
Q 018806 106 SWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTS-D----SQ---RDVKVLE-WRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 106 ~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~-~----~~---~~v~~~~-~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
-.+.||+.|+. +..|.|.++|.++..-+.+..-.. . .. .+..-+. |++-...+++.-+.|...|.+.. .
T Consensus 273 ~~nsDGkrIvF-q~~GdIylydP~td~lekldI~lpl~rk~k~~k~~~pskyledfa~~~Gd~ia~VSRGkaFi~~~~-~ 350 (668)
T COG4946 273 NANSDGKRIVF-QNAGDIYLYDPETDSLEKLDIGLPLDRKKKQPKFVNPSKYLEDFAVVNGDYIALVSRGKAFIMRPW-D 350 (668)
T ss_pred ccCCCCcEEEE-ecCCcEEEeCCCcCcceeeecCCccccccccccccCHHHhhhhhccCCCcEEEEEecCcEEEECCC-C
Confidence 44568888887 677889999986533222111100 0 00 1111111 44433445555555677766554 1
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGG 256 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~ 256 (350)
+..- -.++ .+.|.-..+.-+++-++.+..|.-.+-++|.++++...+...-+.
T Consensus 351 ~~~i--------------------------qv~~-~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~kr~e~~lg~ 403 (668)
T COG4946 351 GYSI--------------------------QVGK-KGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVKRIEKDLGN 403 (668)
T ss_pred CeeE--------------------------EcCC-CCceEEEEEccCCcceEEeccCCceEEEEecCCceEEEeeCCccc
Confidence 1111 1122 356888888888888888888833999999999988888888899
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
|.++..+++|++++++.....+.++|+++++..... ...+-|+.++|+|+++++|.+.-.......+++.
T Consensus 404 I~av~vs~dGK~~vvaNdr~el~vididngnv~~idkS~~~lItdf~~~~nsr~iAYafP~gy~tq~Ikly 474 (668)
T COG4946 404 IEAVKVSPDGKKVVVANDRFELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWIAYAFPEGYYTQSIKLY 474 (668)
T ss_pred eEEEEEcCCCcEEEEEcCceEEEEEEecCCCeeEecccccceeEEEEEcCCceeEEEecCcceeeeeEEEE
Confidence 999999999999999998899999999999985443 4567899999999999999987444333444433
No 265
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=99.02 E-value=5.5e-08 Score=84.97 Aligned_cols=100 Identities=20% Similarity=0.400 Sum_probs=69.6
Q ss_pred ceeeEEECCCCCeEEEEEeC--CCeEEEEeCCCC-Ccee-eee-cCCCeEEEEEcCCCCEEEEE---ecCCeEEEEeCCC
Q 018806 214 QITALSWGPDGRYLASASYE--SSSFTIWDVAQG-LGTP-IRR-GFGGLSILKWSPTGDYFFAA---KFDGTFYLWETNT 285 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~~~-~~~~-~~~-~~~~v~~~~~sp~g~~l~~~---~~d~~v~iwd~~~ 285 (350)
.|...+|.|.|..+++-+.+ ..++.+|-+.+. .... +.. .......+.|+|.|++++.+ +..|.+.++|+.-
T Consensus 447 ~vi~FaWEP~gdkF~vi~g~~~k~tvsfY~~e~~~~~~~lVk~~dk~~~N~vfwsPkG~fvvva~l~s~~g~l~F~D~~~ 526 (698)
T KOG2314|consen 447 SVIAFAWEPHGDKFAVISGNTVKNTVSFYAVETNIKKPSLVKELDKKFANTVFWSPKGRFVVVAALVSRRGDLEFYDTDY 526 (698)
T ss_pred heeeeeeccCCCeEEEEEccccccceeEEEeecCCCchhhhhhhcccccceEEEcCCCcEEEEEEecccccceEEEecch
Confidence 56688999999887765432 237888988742 2211 111 23556789999999998765 4578999999985
Q ss_pred Cce--eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 286 WTS--EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 286 ~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
... .....|. ..+.+.|.|.|+|+++++
T Consensus 527 a~~k~~~~~eh~-~at~veWDPtGRYvvT~s 556 (698)
T KOG2314|consen 527 ADLKDTASPEHF-AATEVEWDPTGRYVVTSS 556 (698)
T ss_pred hhhhhccCcccc-ccccceECCCCCEEEEee
Confidence 333 2333343 467889999999999884
No 266
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=99.00 E-value=1.8e-08 Score=81.27 Aligned_cols=187 Identities=11% Similarity=0.122 Sum_probs=125.5
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~ 179 (350)
..-++.|++.+..++++..+|.+.+-+.....-+... ..+.|+-.++-..|+-....+++.|+ |+.+..||++.++.
T Consensus 123 ~~lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq-~wk~He~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R~p~~- 200 (339)
T KOG0280|consen 123 EALSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQ-TWKVHEFEAWTAKFSDKEPNLVYTGGDDGSLSCWDIRIPKT- 200 (339)
T ss_pred eeeEEEeeccCceEEEEcCCCcEEEEecceeeeeecc-cccccceeeeeeecccCCCceEEecCCCceEEEEEecCCcc-
Confidence 3567889999999999888999885554221111111 23579999999999866555666555 69999999984431
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCC-CceeeeecCCCe
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQG-LGTPIRRGFGGL 257 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~-~~~~~~~~~~~v 257 (350)
.++...+.|. ..|.++.-+| .+.+|++|+.|. .|++||.+.. ++..-..-.++|
T Consensus 201 ----------------------~i~~n~kvH~-~GV~SI~ss~~~~~~I~TGsYDe-~i~~~DtRnm~kPl~~~~v~GGV 256 (339)
T KOG0280|consen 201 ----------------------FIWHNSKVHT-SGVVSIYSSPPKPTYIATGSYDE-CIRVLDTRNMGKPLFKAKVGGGV 256 (339)
T ss_pred ----------------------eeeecceeee-cceEEEecCCCCCceEEEecccc-ceeeeehhcccCccccCccccce
Confidence 1233345555 6888888876 578999999997 9999999964 333333345899
Q ss_pred EEEEEcCCC--CEEEEEecCCeEEEEeCCCCcee---c---cccCCCCeEEEEEcCCCCEEEEEE
Q 018806 258 SILKWSPTG--DYFFAAKFDGTFYLWETNTWTSE---P---WSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 258 ~~~~~sp~g--~~l~~~~~d~~v~iwd~~~~~~~---~---~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+.+.++|.- +.|+++..+| .+|.+...+... . ...|.+-+..-.|......|++++
T Consensus 257 WRi~~~p~~~~~lL~~CMh~G-~ki~~~~~~~~e~~~~~~s~~~hdSl~YG~DWd~~~~~lATCs 320 (339)
T KOG0280|consen 257 WRIKHHPEIFHRLLAACMHNG-AKILDSSDKVLEFQIVLPSDKIHDSLCYGGDWDSKDSFLATCS 320 (339)
T ss_pred EEEEecchhhhHHHHHHHhcC-ceEEEecccccchheeeeccccccceeeccccccccceeeeee
Confidence 999999953 3345544444 677777655432 1 235556666667755555677765
No 267
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=99.00 E-value=1.9e-08 Score=84.46 Aligned_cols=158 Identities=13% Similarity=0.104 Sum_probs=107.9
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCC-CceeEecCCCCCCeeEEEEeeCCCeEEEEecC---CcEEEEecCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEG-KDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---GGICIWAPSYP 176 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~-~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~~v~iwd~~~~ 176 (350)
.+..+..++.+++||.+..+....++++..... ...... ..-...-+++.|..+....+.+-.. ..+.+|....
T Consensus 64 a~~~~~~s~~~~llAv~~~~K~~~~f~~~~~~~~~kl~~~-~~v~~~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~~- 141 (390)
T KOG3914|consen 64 APALVLTSDSGRLVAVATSSKQRAVFDYRENPKGAKLLDV-SCVPKRPTAISFIREDTSVLVADKAGDVYSFDILSADS- 141 (390)
T ss_pred cccccccCCCceEEEEEeCCCceEEEEEecCCCcceeeeE-eecccCcceeeeeeccceEEEEeecCCceeeeeecccc-
Confidence 355667788999999998888877888764332 111111 1223344556665554555554443 4445555442
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--eeeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--PIRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~~~~~~ 254 (350)
.. ...+-||- +.+++++|+||+++|+++..| ..|++-........ ...+|.
T Consensus 142 ~~-------------------------~~~~lGhv-Sml~dVavS~D~~~IitaDRD-EkIRvs~ypa~f~IesfclGH~ 194 (390)
T KOG3914|consen 142 GR-------------------------CEPILGHV-SMLLDVAVSPDDQFIITADRD-EKIRVSRYPATFVIESFCLGHK 194 (390)
T ss_pred cC-------------------------cchhhhhh-hhhheeeecCCCCEEEEecCC-ceEEEEecCcccchhhhccccH
Confidence 11 12245665 789999999999999999999 59999877654433 355788
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
.-|..++.-++. .|++++.|++|++||+.+|+.
T Consensus 195 eFVS~isl~~~~-~LlS~sGD~tlr~Wd~~sgk~ 227 (390)
T KOG3914|consen 195 EFVSTISLTDNY-LLLSGSGDKTLRLWDITSGKL 227 (390)
T ss_pred hheeeeeeccCc-eeeecCCCCcEEEEecccCCc
Confidence 889999987654 589999999999999999986
No 268
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.99 E-value=1.4e-08 Score=82.58 Aligned_cols=227 Identities=15% Similarity=0.189 Sum_probs=142.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCce--eEecCCCC------------CCeeEEEEeeCCC--eEEEEe
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDA--CILTSDSQ------------RDVKVLEWRPNGG--RSLSVG 163 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~--~~~~~~~~------------~~v~~~~~sp~~~--~l~~~~ 163 (350)
..|+++.|...|.+||+|...|.|.++.-+...+-.. ..-+++|. ..|..+.|..+++ .++.++
T Consensus 27 d~ItaVefd~tg~YlatGDkgGRVvlfer~~s~~ceykf~teFQshe~EFDYLkSleieEKin~I~w~~~t~r~hFLlst 106 (460)
T COG5170 27 DKITAVEFDETGLYLATGDKGGRVVLFEREKSYGCEYKFFTEFQSHELEFDYLKSLEIEEKINAIEWFDDTGRNHFLLST 106 (460)
T ss_pred ceeeEEEeccccceEeecCCCceEEEeecccccccchhhhhhhcccccchhhhhhccHHHHhhheeeecCCCcceEEEec
Confidence 3589999999999999998889999987643221110 00122332 3588899976643 577888
Q ss_pred cCCcEEEEecCCCCCCceeecc---------cccccce-----e-cCCCCCceEEeee---c-cCCCCCceeeEEECCCC
Q 018806 164 CKGGICIWAPSYPGNAASVRSG---------AASFLGA-----L-SRGPGTRWTLVDF---L-RSQNGEQITALSWGPDG 224 (350)
Q Consensus 164 ~d~~v~iwd~~~~~~~~~~~~~---------~~~~~~~-----~-~~~~~~~~~~~~~---~-~~~~~~~v~~~~~sp~g 224 (350)
.|++|++|.+... +...+... ...+..+ + ..+....+..... . ..| .-.+.+++|+.|.
T Consensus 107 NdktiKlWKiyek-nlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH-~yhiNSiS~NsD~ 184 (460)
T COG5170 107 NDKTIKLWKIYEK-NLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAH-PYHINSISFNSDK 184 (460)
T ss_pred CCceeeeeeeecc-cchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccc-eeEeeeeeecCch
Confidence 8999999998732 22222111 0001111 0 0111222222221 2 234 3578899999998
Q ss_pred CeEEEEEeCCCeEEEEeCCCCCc----eeeeecC-----CCeEEEEEcCCC-CEEEEEecCCeEEEEeCCCCce-----e
Q 018806 225 RYLASASYESSSFTIWDVAQGLG----TPIRRGF-----GGLSILKWSPTG-DYFFAAKFDGTFYLWETNTWTS-----E 289 (350)
Q Consensus 225 ~~l~~~~~d~g~i~iwd~~~~~~----~~~~~~~-----~~v~~~~~sp~g-~~l~~~~~d~~v~iwd~~~~~~-----~ 289 (350)
+.++++.. -.|.+|++.-... .-+..|. .-|++..|+|.. ..+...+..|.|++-|++.... .
T Consensus 185 et~lSaDd--LrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSsSkG~Ikl~DlRq~alcdn~~k 262 (460)
T COG5170 185 ETLLSADD--LRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSSSKGEIKLNDLRQSALCDNSKK 262 (460)
T ss_pred heeeeccc--eeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEecCCCcEEehhhhhhhhccCchh
Confidence 88887643 3899999875422 1222332 347888999964 4566777899999999984322 1
Q ss_pred c------------cccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC
Q 018806 290 P------------WSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP 330 (350)
Q Consensus 290 ~------------~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~ 330 (350)
. +......|..+.|+++|+++++-.-....+|++++...+.
T Consensus 263 lfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdyltvkiwDvnm~k~pi 315 (460)
T COG5170 263 LFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDYLTVKIWDVNMAKNPI 315 (460)
T ss_pred hhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEeccceEEEEecccccCCc
Confidence 1 1122356889999999999998766667777777766554
No 269
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=98.96 E-value=4.3e-08 Score=87.15 Aligned_cols=197 Identities=19% Similarity=0.284 Sum_probs=128.4
Q ss_pred CeeEEEEecCCCEEEEEE---CC-CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEE--EEec
Q 018806 101 DLQGVSWHQHKHIVAFIS---GS-TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGIC--IWAP 173 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s---~d-~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~--iwd~ 173 (350)
.+..-.|+|+++.++..+ .. ..+.+++++. +....... ..+.-...+|+|||++++.+.. |+... +.|+
T Consensus 194 ~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~--g~~~~i~~--~~g~~~~P~fspDG~~l~f~~~rdg~~~iy~~dl 269 (425)
T COG0823 194 LILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNT--GKRPVILN--FNGNNGAPAFSPDGSKLAFSSSRDGSPDIYLMDL 269 (425)
T ss_pred ceeccccCcCCCceEEEEEecCCCceEEEEeccC--Cccceeec--cCCccCCccCCCCCCEEEEEECCCCCccEEEEcC
Confidence 577789999998887754 22 3577888865 44333332 3445667899999999888877 55554 4455
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC--eEEEEeCCCCCceeee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS--SFTIWDVAQGLGTPIR 251 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~ 251 (350)
....... +.. . .+.-..-.|+|||++|+..+...| .|.+++.+.+....+.
T Consensus 270 ~~~~~~~-Lt~-------------------------~-~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~~riT 322 (425)
T COG0823 270 DGKNLPR-LTN-------------------------G-FGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQVTRLT 322 (425)
T ss_pred CCCccee-ccc-------------------------C-CccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCceeEee
Confidence 5322111 111 1 123347789999999999987756 5666677777665555
Q ss_pred ecCCCeEEEEEcCCCCEEEEEec-CCe--EEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECC--CeEEEEEEeC
Q 018806 252 RGFGGLSILKWSPTGDYFFAAKF-DGT--FYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAG--SLTLGSIHFA 326 (350)
Q Consensus 252 ~~~~~v~~~~~sp~g~~l~~~~~-d~~--v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~--~~~~~~~~~~ 326 (350)
...+.-....|+|||++|+..+. +|. |.+.|+.++...+............|.++|+.++..++. ...+..+...
T Consensus 323 ~~~~~~~~p~~SpdG~~i~~~~~~~g~~~i~~~~~~~~~~~~~lt~~~~~e~ps~~~ng~~i~~~s~~~~~~~l~~~s~~ 402 (425)
T COG0823 323 FSGGGNSNPVWSPDGDKIVFESSSGGQWDIDKNDLASGGKIRILTSTYLNESPSWAPNGRMIMFSSGQGGGSVLSLVSLD 402 (425)
T ss_pred ccCCCCcCccCCCCCCEEEEEeccCCceeeEEeccCCCCcEEEccccccCCCCCcCCCCceEEEeccCCCCceEEEeecc
Confidence 55444448899999999987664 343 777777776644444444555677899999999887632 3445555444
Q ss_pred CC
Q 018806 327 SK 328 (350)
Q Consensus 327 ~~ 328 (350)
.+
T Consensus 403 g~ 404 (425)
T COG0823 403 GR 404 (425)
T ss_pred ce
Confidence 43
No 270
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.93 E-value=6.5e-07 Score=87.32 Aligned_cols=224 Identities=14% Similarity=0.246 Sum_probs=137.4
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
.....|.++.+-++...|+.+..+|.|.+...+.............-+..|.+++||||++.++.+..++++.+.+-...
T Consensus 73 ~~~~~ivs~~yl~d~~~l~~~~~~Gdi~~~~~~~~~~~~~~E~VG~vd~GI~a~~WSPD~Ella~vT~~~~l~~mt~~fd 152 (928)
T PF04762_consen 73 DPNDKIVSFQYLADSESLCIALASGDIILVREDPDPDEDEIEIVGSVDSGILAASWSPDEELLALVTGEGNLLLMTRDFD 152 (928)
T ss_pred CCCCcEEEEEeccCCCcEEEEECCceEEEEEccCCCCCceeEEEEEEcCcEEEEEECCCcCEEEEEeCCCEEEEEeccce
Confidence 34457999999999999999999999999832211122222222235678999999999888888888888877654411
Q ss_pred C------------CCceeecccccccceecCCCCCceE--Ee---------eeccCCCCCceeeEEECCCCCeEEEEEe-
Q 018806 177 G------------NAASVRSGAASFLGALSRGPGTRWT--LV---------DFLRSQNGEQITALSWGPDGRYLASASY- 232 (350)
Q Consensus 177 ~------------~~~~~~~~~~~~~~~~~~~~~~~~~--~~---------~~~~~~~~~~v~~~~~sp~g~~l~~~~~- 232 (350)
. ..+.+.-+-.+..+.|..+....-. .. ..+. . +..-..++|-.||+++|+.+.
T Consensus 153 ~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~~d~~~~s-~-dd~~~~ISWRGDG~yFAVss~~ 230 (928)
T PF04762_consen 153 PISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPKVDEGKLS-W-DDGRVRISWRGDGEYFAVSSVE 230 (928)
T ss_pred EEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCccccCccc-c-CCCceEEEECCCCcEEEEEEEE
Confidence 1 1111111111111112111111000 00 0111 1 235578999999999998875
Q ss_pred --C--CCeEEEEeCCCCCceeeeecC-CCeEEEEEcCCCCEEEEEec---CCeEEEEeCCCCcee----ccccCCCCeEE
Q 018806 233 --E--SSSFTIWDVAQGLGTPIRRGF-GGLSILKWSPTGDYFFAAKF---DGTFYLWETNTWTSE----PWSSTSGFVTG 300 (350)
Q Consensus 233 --d--~g~i~iwd~~~~~~~~~~~~~-~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~~~~~~----~~~~~~~~v~~ 300 (350)
. ...+++|+-+ |......+.. +--.+++|-|.|++||+... ...|.+|.-+.-+.. ++......|..
T Consensus 231 ~~~~~~R~iRVy~Re-G~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfErNGLrhgeF~l~~~~~~~~v~~ 309 (928)
T PF04762_consen 231 PETGSRRVIRVYSRE-GELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFERNGLRHGEFTLRFDPEEEKVIE 309 (928)
T ss_pred cCCCceeEEEEECCC-ceEEeccccCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEecCCcEeeeEecCCCCCCceeeE
Confidence 2 1389999976 5443333322 33447899999999988754 346777765443332 22245668999
Q ss_pred EEEcCCCCEEEEEECCCeEEEEE
Q 018806 301 ATWDPEGRMILLAFAGSLTLGSI 323 (350)
Q Consensus 301 ~~~s~~g~~l~~~~~~~~~~~~~ 323 (350)
+.|++|+..|++-..+.+.+|..
T Consensus 310 l~Wn~ds~iLAv~~~~~vqLWt~ 332 (928)
T PF04762_consen 310 LAWNSDSEILAVWLEDRVQLWTR 332 (928)
T ss_pred EEECCCCCEEEEEecCCceEEEe
Confidence 99999999999987555555543
No 271
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=98.90 E-value=1.2e-07 Score=84.25 Aligned_cols=145 Identities=21% Similarity=0.335 Sum_probs=103.6
Q ss_pred CCCCeeEEEEeeCCCeEEEEecC--C--cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeE
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCK--G--GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITAL 218 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d--~--~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 218 (350)
....+...+|+|++..+++.... + .+.++++..+.....+. + .+.-...
T Consensus 191 ~~~~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~-----------------------~----~g~~~~P 243 (425)
T COG0823 191 SGSLILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRPVILN-----------------------F----NGNNGAP 243 (425)
T ss_pred cCcceeccccCcCCCceEEEEEecCCCceEEEEeccCCccceeec-----------------------c----CCccCCc
Confidence 34568888999999988877553 3 48888888554433322 1 1344567
Q ss_pred EECCCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC-C--eEEEEeCCCCceecccc
Q 018806 219 SWGPDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD-G--TFYLWETNTWTSEPWSS 293 (350)
Q Consensus 219 ~~sp~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d-~--~v~iwd~~~~~~~~~~~ 293 (350)
+|+|||+.|+.+...+| .|+++|+.++....+....+.-..-.|+|||++|+..+.. | .|+++|.+.+...++..
T Consensus 244 ~fspDG~~l~f~~~rdg~~~iy~~dl~~~~~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~~riT~ 323 (425)
T COG0823 244 AFSPDGSKLAFSSSRDGSPDIYLMDLDGKNLPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQVTRLTF 323 (425)
T ss_pred cCCCCCCEEEEEECCCCCccEEEEcCCCCcceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCceeEeec
Confidence 99999999998876556 5667788877755555445555588999999999876553 3 68888888887755554
Q ss_pred CCCCeEEEEEcCCCCEEEEEE
Q 018806 294 TSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 294 ~~~~v~~~~~s~~g~~l~~~~ 314 (350)
....-....|+|||++|+...
T Consensus 324 ~~~~~~~p~~SpdG~~i~~~~ 344 (425)
T COG0823 324 SGGGNSNPVWSPDGDKIVFES 344 (425)
T ss_pred cCCCCcCccCCCCCCEEEEEe
Confidence 444444789999999999887
No 272
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=98.90 E-value=2.3e-07 Score=74.97 Aligned_cols=180 Identities=13% Similarity=0.112 Sum_probs=118.0
Q ss_pred CeeEEEEec---CCC-EEEEEECCCeEEEEEccCCCCCceeEec--CCC---CCCeeEEEEeeCCCeEEEEecCCcEEEE
Q 018806 101 DLQGVSWHQ---HKH-IVAFISGSTQVIVRDYEDSEGKDACILT--SDS---QRDVKVLEWRPNGGRSLSVGCKGGICIW 171 (350)
Q Consensus 101 ~V~~v~~sp---~g~-~la~~s~d~~i~iw~~~~~~~~~~~~~~--~~~---~~~v~~~~~sp~~~~l~~~~~d~~v~iw 171 (350)
.+..+.|.. +|. .++-+...|.|.++..+..... ..+. ... .....++.|++.+..+++.-.+|.+.+-
T Consensus 71 ~~~dm~w~~~~~~g~~~l~~a~a~G~i~~~r~~~~~ss--~~L~~ls~~ki~~~~~lslD~~~~~~~i~vs~s~G~~~~v 148 (339)
T KOG0280|consen 71 TEFDMLWRIRETDGDFNLLDAHARGQIQLYRNDEDESS--VHLRGLSSKKISVVEALSLDISTSGTKIFVSDSRGSISGV 148 (339)
T ss_pred ccceeeeeeccCCccceeeeccccceEEEEeeccceee--eeecccchhhhhheeeeEEEeeccCceEEEEcCCCcEEEE
Confidence 456666653 445 5556677899999887532111 1111 011 1124578899988888777778888854
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCCC-cee
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG-RYLASASYESSSFTIWDVAQGL-GTP 249 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~~-~~~ 249 (350)
+.. ..... -.+..+.|. ..++...|+... +.+++|+.| |.+..||++... ...
T Consensus 149 ~~t-~~~le----------------------~vq~wk~He-~E~Wta~f~~~~pnlvytGgDD-~~l~~~D~R~p~~~i~ 203 (339)
T KOG0280|consen 149 YET-EMVLE----------------------KVQTWKVHE-FEAWTAKFSDKEPNLVYTGGDD-GSLSCWDIRIPKTFIW 203 (339)
T ss_pred ecc-eeeee----------------------ecccccccc-eeeeeeecccCCCceEEecCCC-ceEEEEEecCCcceee
Confidence 443 11111 123466665 688888887654 455666666 799999999443 222
Q ss_pred --eeecCCCeEEEEEcC-CCCEEEEEecCCeEEEEeCCCC-ceeccccCCCCeEEEEEcCCC
Q 018806 250 --IRRGFGGLSILKWSP-TGDYFFAAKFDGTFYLWETNTW-TSEPWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 250 --~~~~~~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~~~~-~~~~~~~~~~~v~~~~~s~~g 307 (350)
...|..+|.++.-+| .+.+|++|+.|-.|++||.++. +...-..-.+.|+.+.++|.-
T Consensus 204 ~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kPl~~~~v~GGVWRi~~~p~~ 265 (339)
T KOG0280|consen 204 HNSKVHTSGVVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKPLFKAKVGGGVWRIKHHPEI 265 (339)
T ss_pred ecceeeecceEEEecCCCCCceEEEeccccceeeeehhcccCccccCccccceEEEEecchh
Confidence 334778888888776 5789999999999999999954 444333456889999999853
No 273
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=98.86 E-value=1e-06 Score=70.48 Aligned_cols=186 Identities=11% Similarity=-0.010 Sum_probs=122.4
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC-CCeEEEEecCCcEEEEecCCCCCCceeeccccccc
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN-GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFL 190 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~ 190 (350)
.+||.|+..|...+|...++++.. .+...|...|+-+.=.-+ ...++.++.|.++++.+++.+.....
T Consensus 85 ~~la~gG~~g~fd~~~~~tn~~h~--~~cd~snn~v~~~~r~cd~~~~~~i~sndht~k~~~~~~~s~~~~--------- 153 (344)
T KOG4532|consen 85 VTLADGGASGQFDLFACNTNDGHL--YQCDVSNNDVTLVKRYCDLKFPLNIASNDHTGKTMVVSGDSNKFA--------- 153 (344)
T ss_pred cEEEeccccceeeeecccCcccce--eeecccccchhhhhhhcccccceeeccCCcceeEEEEecCcccce---------
Confidence 578999999999999987544322 221223333322211111 13466777788888888873322111
Q ss_pred ceecCCCCCceEEeeeccCCCC-CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--e--eeecCCCeEEEEEcCC
Q 018806 191 GALSRGPGTRWTLVDFLRSQNG-EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--P--IRRGFGGLSILKWSPT 265 (350)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~-~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~--~~~~~~~v~~~~~sp~ 265 (350)
.|.. -.+.++++++|++++++.+... .|..|.+...... . .......-.+..|+..
T Consensus 154 ------------------~h~~~~~~ns~~~snd~~~~~~Vgds~-~Vf~y~id~~sey~~~~~~a~t~D~gF~~S~s~~ 214 (344)
T KOG4532|consen 154 ------------------VHNQNLTQNSLHYSNDPSWGSSVGDSR-RVFRYAIDDESEYIENIYEAPTSDHGFYNSFSEN 214 (344)
T ss_pred ------------------eeccccceeeeEEcCCCceEEEecCCC-cceEEEeCCccceeeeeEecccCCCceeeeeccC
Confidence 1111 2367899999999999998885 9999998764322 2 2223455677899999
Q ss_pred CCEEEEEecCCeEEEEeCCCCce------eccccCCCCeEEEEEcCCCCE-EEEEECCCeEEEEEEeCC
Q 018806 266 GDYFFAAKFDGTFYLWETNTWTS------EPWSSTSGFVTGATWDPEGRM-ILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 266 g~~l~~~~~d~~v~iwd~~~~~~------~~~~~~~~~v~~~~~s~~g~~-l~~~~~~~~~~~~~~~~~ 327 (350)
...+|++..||++.|||++.... .+...|.+.+..+.|++-|.. |+.-+..-.++..+++..
T Consensus 215 ~~~FAv~~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs~~hv~D~R~ 283 (344)
T KOG4532|consen 215 DLQFAVVFQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFSRVHVVDTRN 283 (344)
T ss_pred cceEEEEecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCcceEEEEecCcceEEEEEccc
Confidence 99999999999999999987554 223468899999999986643 333344445566666543
No 274
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.81 E-value=9e-08 Score=84.19 Aligned_cols=180 Identities=16% Similarity=0.174 Sum_probs=121.1
Q ss_pred CCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCC-CCCceEEeeeccCCCCCceeeEEE----CCCCCeEEEE
Q 018806 156 GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRG-PGTRWTLVDFLRSQNGEQITALSW----GPDGRYLASA 230 (350)
Q Consensus 156 ~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~v~~~~~----sp~g~~l~~~ 230 (350)
..+++....||.+++|+...++....+.+. ..++.. -...|.+.- +.......++.+ +-+-..++-|
T Consensus 5 ~~~~A~~~~~g~l~iw~t~~~~~~~e~~p~-----~~~s~t~~~~~w~L~~---~~s~~k~~~~~~~~~~s~~t~~lvlg 76 (541)
T KOG4547|consen 5 LDYFALSTGDGRLRIWDTAKNQLQQEFAPI-----ASLSGTCTYTKWGLSA---DYSPMKWLSLEKAKKASLDTSMLVLG 76 (541)
T ss_pred hheEeecCCCCeEEEEEccCceeeeeeccc-----hhccCcceeEEEEEEe---ccchHHHHhHHHHhhccCCceEEEee
Confidence 345666777899999999865544333222 111110 011222111 111111222222 2233456666
Q ss_pred EeCCCeEEEEeCCCCCceeee---ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeEEEEEcCC
Q 018806 231 SYESSSFTIWDVAQGLGTPIR---RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVTGATWDPE 306 (350)
Q Consensus 231 ~~d~g~i~iwd~~~~~~~~~~---~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~~~~~s~~ 306 (350)
... |.|.+|++..++..... .|.+.|.++.++.+-..|.+++.|..+..|+....... .+......+.+++.+||
T Consensus 77 t~~-g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D 155 (541)
T KOG4547|consen 77 TPQ-GSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPD 155 (541)
T ss_pred cCC-ccEEEEEecCCeEEEEEecCCCCCcceeeecccccCceEecCCceeEEEEecccceeeeeeccCCCccceEEEcCC
Confidence 666 89999999999876544 36788999999999889999999999999999998874 45566778899999999
Q ss_pred CCEEEEEECCCeEEEEEEeCCCCC--CCceeecccccceeecc
Q 018806 307 GRMILLAFAGSLTLGSIHFASKPP--SLDAHLLPVDLPDIVSL 347 (350)
Q Consensus 307 g~~l~~~~~~~~~~~~~~~~~~~~--~~~~~~~~v~~~~~~~~ 347 (350)
|+.|++++ ..+..|++..+.. .+++|..||+...+..+
T Consensus 156 ~~~l~~as---~~ik~~~~~~kevv~~ftgh~s~v~t~~f~~~ 195 (541)
T KOG4547|consen 156 GKILLTAS---RQIKVLDIETKEVVITFTGHGSPVRTLSFTTL 195 (541)
T ss_pred CCEEEecc---ceEEEEEccCceEEEEecCCCcceEEEEEEEe
Confidence 99999875 4556666665544 88999999998877654
No 275
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=98.79 E-value=1e-06 Score=87.45 Aligned_cols=178 Identities=13% Similarity=0.088 Sum_probs=108.3
Q ss_pred eeEEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEec-------CC------CCCCeeEEEEeeCCCeEEEEec-CC
Q 018806 102 LQGVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILT-------SD------SQRDVKVLEWRPNGGRSLSVGC-KG 166 (350)
Q Consensus 102 V~~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~-------~~------~~~~v~~~~~sp~~~~l~~~~~-d~ 166 (350)
-+.++|+| ++.++++.+.++.|++|+... +....... .+ .-.....++|+|+++.++++.. ++
T Consensus 685 P~gVa~dp~~g~LyVad~~~~~I~v~d~~~--g~v~~~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~ 762 (1057)
T PLN02919 685 PWDVCFEPVNEKVYIAMAGQHQIWEYNISD--GVTRVFSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESS 762 (1057)
T ss_pred CeEEEEecCCCeEEEEECCCCeEEEEECCC--CeEEEEecCCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCC
Confidence 46899999 555666666788899999753 22111000 00 0123567999999886766665 59
Q ss_pred cEEEEecCCCCCCceeeccc-ccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC
Q 018806 167 GICIWAPSYPGNAASVRSGA-ASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG 245 (350)
Q Consensus 167 ~v~iwd~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~ 245 (350)
.|++||+..... ..+..+. ........++..+.... ... ......++++++|+.+++-..+ +.|++||..++
T Consensus 763 ~Irv~D~~tg~~-~~~~gg~~~~~~~l~~fG~~dG~g~----~~~-l~~P~Gvavd~dG~LYVADs~N-~rIrviD~~tg 835 (1057)
T PLN02919 763 SIRALDLKTGGS-RLLAGGDPTFSDNLFKFGDHDGVGS----EVL-LQHPLGVLCAKDGQIYVADSYN-HKIKKLDPATK 835 (1057)
T ss_pred eEEEEECCCCcE-EEEEecccccCcccccccCCCCchh----hhh-ccCCceeeEeCCCcEEEEECCC-CEEEEEECCCC
Confidence 999999874331 1111000 00000001110000000 000 1234689999999876666666 69999999887
Q ss_pred Cceeeeec--------------CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 246 LGTPIRRG--------------FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 246 ~~~~~~~~--------------~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
....+.+. -.....++++++|+.+++-+.++.|++||+++++.
T Consensus 836 ~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVaDt~Nn~Irvid~~~~~~ 892 (1057)
T PLN02919 836 RVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVADTNNSLIRYLDLNKGEA 892 (1057)
T ss_pred eEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEEECCCCEEEEEECCCCcc
Confidence 65544321 12467899999999888888899999999998764
No 276
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.77 E-value=3.8e-08 Score=86.03 Aligned_cols=154 Identities=15% Similarity=0.181 Sum_probs=103.2
Q ss_pred cCCCEEEEEECCCeEEEEEccCCC---CCceeEec-CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeec
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDSE---GKDACILT-SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRS 184 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~~---~~~~~~~~-~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~ 184 (350)
.+.+-+++++.|+++++|.+.... +...++++ ..|..+|.++.|-.+-+. .++.|+.+++||.-.+....++..
T Consensus 745 dNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~--i~ScD~giHlWDPFigr~Laq~~d 822 (1034)
T KOG4190|consen 745 DNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRS--IASCDGGIHLWDPFIGRLLAQMED 822 (1034)
T ss_pred ccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccce--eeeccCcceeecccccchhHhhhc
Confidence 366778899999999999986321 11223332 369999999999887333 356789999999764443332221
Q ss_pred ccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEE-EEeCCCeEEEEeCCCCCcee---eee---cCC
Q 018806 185 GAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLAS-ASYESSSFTIWDVAQGLGTP---IRR---GFG 255 (350)
Q Consensus 185 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~-~~~d~g~i~iwd~~~~~~~~---~~~---~~~ 255 (350)
. ...+.+..+..-++ ...+.. ++..+ +|+++|.+.++... +-. ...
T Consensus 823 a------------------------pk~~a~~~ikcl~nv~~~iliAgcsaeS-TVKl~DaRsce~~~E~kVcna~~Pna 877 (1034)
T KOG4190|consen 823 A------------------------PKEGAGGNIKCLENVDRHILIAGCSAES-TVKLFDARSCEWTCELKVCNAPGPNA 877 (1034)
T ss_pred C------------------------cccCCCceeEecccCcchheeeeccchh-hheeeecccccceeeEEeccCCCCch
Confidence 1 11123333333333 233333 35664 99999999886532 111 234
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE 289 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~ 289 (350)
-+.+++..+.|++++++-.+|.|.+.|.++|+..
T Consensus 878 ~~R~iaVa~~GN~lAa~LSnGci~~LDaR~G~vI 911 (1034)
T KOG4190|consen 878 LTRAIAVADKGNKLAAALSNGCIAILDARNGKVI 911 (1034)
T ss_pred heeEEEeccCcchhhHHhcCCcEEEEecCCCcee
Confidence 5889999999999999999999999999999963
No 277
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=98.77 E-value=5.6e-06 Score=67.15 Aligned_cols=197 Identities=14% Similarity=0.224 Sum_probs=114.7
Q ss_pred EEEecCCCEEEEEECCCeEEEEEccCCCCC--ceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCcee
Q 018806 105 VSWHQHKHIVAFISGSTQVIVRDYEDSEGK--DACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASV 182 (350)
Q Consensus 105 v~~sp~g~~la~~s~d~~i~iw~~~~~~~~--~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~ 182 (350)
++.+.+|+.||. -.|..|.|-...++-.. ..+.+..+....=..++||||+..++.+.+.|+|+++|+. +.....+
T Consensus 3 ~~~~~~Gk~lAi-~qd~~iEiRsa~Ddf~si~~kcqVpkD~~PQWRkl~WSpD~tlLa~a~S~G~i~vfdl~-g~~lf~I 80 (282)
T PF15492_consen 3 LALSSDGKLLAI-LQDQCIEIRSAKDDFSSIIGKCQVPKDPNPQWRKLAWSPDCTLLAYAESTGTIRVFDLM-GSELFVI 80 (282)
T ss_pred eeecCCCcEEEE-EeccEEEEEeccCCchheeEEEecCCCCCchheEEEECCCCcEEEEEcCCCeEEEEecc-cceeEEc
Confidence 567789998886 57777888765432222 1233333344456889999997777777778999999997 3333332
Q ss_pred ecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC------CCeEEEEEeCCCeEEEEeCCCCC-----cee--
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD------GRYLASASYESSSFTIWDVAQGL-----GTP-- 249 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~------g~~l~~~~~d~g~i~iwd~~~~~-----~~~-- 249 (350)
..... ..+.-...|..+.|-+- ...|++-..+ |.++-|-+..+. ...
T Consensus 81 ~p~~~-------------------~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~-G~L~Sy~vs~gt~q~y~e~hsf 140 (282)
T PF15492_consen 81 PPAMS-------------------FPGDLSDAIAGLIFLEYKKSAQWSYELLVINYR-GQLRSYLVSVGTNQGYQENHSF 140 (282)
T ss_pred Ccccc-------------------cCCccccceeeeEeeccccccccceeEEEEecc-ceeeeEEEEcccCCcceeeEEE
Confidence 22110 00001134445545331 2245555666 677777653321 111
Q ss_pred -eee-cCCCeEEEEEcCCCCEEEEEec----CC-------eEEEEeCCCCce---------------------ecc----
Q 018806 250 -IRR-GFGGLSILKWSPTGDYFFAAKF----DG-------TFYLWETNTWTS---------------------EPW---- 291 (350)
Q Consensus 250 -~~~-~~~~v~~~~~sp~g~~l~~~~~----d~-------~v~iwd~~~~~~---------------------~~~---- 291 (350)
+.. ...+|.++.++|.-+.|++|+. ++ -+..|.+-++.. .++
T Consensus 141 sf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~ 220 (282)
T PF15492_consen 141 SFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFK 220 (282)
T ss_pred EecccCCCceeEEEEcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCccccccccccceeecccee
Confidence 111 3578999999999888876643 11 255564432211 000
Q ss_pred -----ccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 292 -----SSTSGFVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 292 -----~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
......|..|..||||+.|++.. ++.+.+|.+
T Consensus 221 ~fs~~~~~~d~i~kmSlSPdg~~La~ih~sG~lsLW~i 258 (282)
T PF15492_consen 221 FFSRQGQEQDGIFKMSLSPDGSLLACIHFSGSLSLWEI 258 (282)
T ss_pred eeeccccCCCceEEEEECCCCCEEEEEEcCCeEEEEec
Confidence 12356789999999999999886 555444443
No 278
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.76 E-value=7.1e-06 Score=70.84 Aligned_cols=209 Identities=13% Similarity=0.062 Sum_probs=114.1
Q ss_pred hhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEE-C-CCeEEEEEccCCCCCceeEecCCCCC------CeeEEEE
Q 018806 81 ISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFIS-G-STQVIVRDYEDSEGKDACILTSDSQR------DVKVLEW 152 (350)
Q Consensus 81 ~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s-~-d~~i~iw~~~~~~~~~~~~~~~~~~~------~v~~~~~ 152 (350)
+......+..|.+++.+.+..-..+++||||++|++.. . +..+.+.|+.. ++.+..+..+-.. .-..+..
T Consensus 86 t~~~~~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n~~p~~~V~VvD~~~--~kvv~ei~vp~~~~vy~t~e~~~~~~ 163 (352)
T TIGR02658 86 THLPIADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQFSPSPAVGVVDLEG--KAFVRMMDVPDCYHIFPTANDTFFMH 163 (352)
T ss_pred cCcEEeEEccCCCchhhccCccceEEECCCCCEEEEecCCCCCEEEEEECCC--CcEEEEEeCCCCcEEEEecCCccEEE
Confidence 33444555666666666666677899999999998765 3 78899999854 4444433221111 1112223
Q ss_pred eeCCCeEEEEec-CCcEEEEecCC--C------CCCceee-ccc------ccccceecCCCCC--ceEEeeecc------
Q 018806 153 RPNGGRSLSVGC-KGGICIWAPSY--P------GNAASVR-SGA------ASFLGALSRGPGT--RWTLVDFLR------ 208 (350)
Q Consensus 153 sp~~~~l~~~~~-d~~v~iwd~~~--~------~~~~~~~-~~~------~~~~~~~~~~~~~--~~~~~~~~~------ 208 (350)
+.||..+..... +|+...=.... . ..+.... .+. ...+..+..+.+. ....+..+.
T Consensus 164 ~~Dg~~~~v~~d~~g~~~~~~~~vf~~~~~~v~~rP~~~~~dg~~~~vs~eG~V~~id~~~~~~~~~~~~~~~~~~~~~~ 243 (352)
T TIGR02658 164 CRDGSLAKVGYGTKGNPKIKPTEVFHPEDEYLINHPAYSNKSGRLVWPTYTGKIFQIDLSSGDAKFLPAIEAFTEAEKAD 243 (352)
T ss_pred eecCceEEEEecCCCceEEeeeeeecCCccccccCCceEcCCCcEEEEecCCeEEEEecCCCcceecceeeecccccccc
Confidence 344333322222 23322111110 0 0000000 000 0000001100000 001111111
Q ss_pred CCCCCceeeEEECCCCCeEEEEEeC---------CCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCC-EEEEEe-cCCe
Q 018806 209 SQNGEQITALSWGPDGRYLASASYE---------SSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGD-YFFAAK-FDGT 277 (350)
Q Consensus 209 ~~~~~~v~~~~~sp~g~~l~~~~~d---------~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~-~l~~~~-~d~~ 277 (350)
+-..+.+.-++++|++++++..... .+.|.++|..+++......-...+..++++|||+ +|++.. .++.
T Consensus 244 ~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~kvi~~i~vG~~~~~iavS~Dgkp~lyvtn~~s~~ 323 (352)
T TIGR02658 244 GWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAKTGKRLRKIELGHEIDSINVSQDAKPLLYALSTGDKT 323 (352)
T ss_pred ccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECCCCeEEEEEeCCCceeeEEECCCCCeEEEEeCCCCCc
Confidence 1122344559999999998875321 1389999999998877666667899999999999 777665 5788
Q ss_pred EEEEeCCCCceecc
Q 018806 278 FYLWETNTWTSEPW 291 (350)
Q Consensus 278 v~iwd~~~~~~~~~ 291 (350)
|.++|..+++....
T Consensus 324 VsViD~~t~k~i~~ 337 (352)
T TIGR02658 324 LYIFDAETGKELSS 337 (352)
T ss_pred EEEEECcCCeEEee
Confidence 99999999987543
No 279
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.76 E-value=5.5e-07 Score=74.40 Aligned_cols=234 Identities=15% Similarity=0.147 Sum_probs=130.4
Q ss_pred chhhhhhhhhhccccccCCCCcCCCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE
Q 018806 73 LFSTLHGIISHSIKPLLHPDHVHLLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW 152 (350)
Q Consensus 73 ~~~~~~gh~~~~~~~~~~p~~~~~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~ 152 (350)
|..-++||...++.+...|. ..-+.+.+.|.+++||--. +.++.-..+......+++++.+
T Consensus 16 ll~~~eG~~d~vn~~~l~~~------------------e~gv~~~s~drtvrv~lkr-ds~q~wpsI~~~mP~~~~~~~y 76 (404)
T KOG1409|consen 16 LLSKIEGSQDDVNAAILIPK------------------EEGVISVSEDRTVRVWLKR-DSGQYWPSIYHYMPSPCSAMEY 76 (404)
T ss_pred hhhhhcCchhhhhhheeccC------------------CCCeEEccccceeeeEEec-cccccCchhhhhCCCCceEeee
Confidence 46677888888666555553 4457788999999999743 3344444444445678999999
Q ss_pred eeCCCeEEEEecCCcEEEEecCCCCCCceee---cccccccceecCCCCCceEEeeec---------cCC-CCCceeeEE
Q 018806 153 RPNGGRSLSVGCKGGICIWAPSYPGNAASVR---SGAASFLGALSRGPGTRWTLVDFL---------RSQ-NGEQITALS 219 (350)
Q Consensus 153 sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~---------~~~-~~~~v~~~~ 219 (350)
.++..+|+.+-..|++.-+.+...-+...+. ......+..+.++-..+|.+.... +.. .-+...-..
T Consensus 77 ~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~lg~Y~~~~ 156 (404)
T KOG1409|consen 77 VSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRLGGYNFET 156 (404)
T ss_pred eccceEEEEEEecceEEEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEeccccceEEEeeccCCcccceEeec
Confidence 9995445444445888877665221111110 111111122222222222221110 000 000000000
Q ss_pred ECCCCCe---EEEEEeCCCeEEEEeCCCCC---ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--ecc
Q 018806 220 WGPDGRY---LASASYESSSFTIWDVAQGL---GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPW 291 (350)
Q Consensus 220 ~sp~g~~---l~~~~~d~g~i~iwd~~~~~---~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~ 291 (350)
+..+-++ .+..+...|.|.+-.+.... ...+.+|.+.+.+++|.+..+.|++|..|..+-+||+-..+- ..+
T Consensus 157 ~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~d~~vi~wdigg~~g~~~el 236 (404)
T KOG1409|consen 157 PASALQFDALYAFVGDHSGQITMLKLEQNGCQLITTFNGHTGEVTCLKWDPGQRLLFSGASDHSVIMWDIGGRKGTAYEL 236 (404)
T ss_pred cCCCCceeeEEEEecccccceEEEEEeecCCceEEEEcCcccceEEEEEcCCCcEEEeccccCceEEEeccCCcceeeee
Confidence 0000011 11111111333333332222 223446778999999999999999999999999999966554 567
Q ss_pred ccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 292 SSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 292 ~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
.+|...|..+...+--+.|.++. ++.+.+|.++.
T Consensus 237 ~gh~~kV~~l~~~~~t~~l~S~~edg~i~~w~mn~ 271 (404)
T KOG1409|consen 237 QGHNDKVQALSYAQHTRQLISCGEDGGIVVWNMNV 271 (404)
T ss_pred ccchhhhhhhhhhhhheeeeeccCCCeEEEEeccc
Confidence 78888998888877777777655 44455555543
No 280
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.74 E-value=6.4e-06 Score=68.73 Aligned_cols=184 Identities=13% Similarity=0.125 Sum_probs=110.3
Q ss_pred eeEEEEe-cCCCEEEEEECCCeEEEEEccCCCCCceeEec-CC-CCCCeeEEEEeeCCCeEEEEecCC----c--EEEEe
Q 018806 102 LQGVSWH-QHKHIVAFISGSTQVIVRDYEDSEGKDACILT-SD-SQRDVKVLEWRPNGGRSLSVGCKG----G--ICIWA 172 (350)
Q Consensus 102 V~~v~~s-p~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~-~~-~~~~v~~~~~sp~~~~l~~~~~d~----~--v~iwd 172 (350)
...+.+. +++.++ .+...+ +.++|+...+-....... .. .....+.+++.|+|+.+++..... . =.+|.
T Consensus 42 ~~G~~~~~~~g~l~-v~~~~~-~~~~d~~~g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~ 119 (246)
T PF08450_consen 42 PNGMAFDRPDGRLY-VADSGG-IAVVDPDTGKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYR 119 (246)
T ss_dssp EEEEEEECTTSEEE-EEETTC-EEEEETTTTEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEE
T ss_pred CceEEEEccCCEEE-EEEcCc-eEEEecCCCcEEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEE
Confidence 6778888 665544 455555 556687542222222221 11 345688999999977555544321 1 23444
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-----
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG----- 247 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~----- 247 (350)
+...+....+. .+ ......++|+|+++.|+.+....+.|..+++.....
T Consensus 120 ~~~~~~~~~~~------------------------~~--~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~~~~~~~~~~ 173 (246)
T PF08450_consen 120 IDPDGKVTVVA------------------------DG--LGFPNGIAFSPDGKTLYVADSFNGRIWRFDLDADGGELSNR 173 (246)
T ss_dssp EETTSEEEEEE------------------------EE--ESSEEEEEEETTSSEEEEEETTTTEEEEEEEETTTCCEEEE
T ss_pred ECCCCeEEEEe------------------------cC--cccccceEECCcchheeecccccceeEEEeccccccceeee
Confidence 43222211111 11 135689999999998876655547999999864322
Q ss_pred eeeeec-C--CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccCCCCeEEEEE-cCCCCEEEEEE
Q 018806 248 TPIRRG-F--GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSSTSGFVTGATW-DPEGRMILLAF 314 (350)
Q Consensus 248 ~~~~~~-~--~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~~v~~~~~-s~~g~~l~~~~ 314 (350)
..+... . +....+++..+|++.++....+.|.++|.+ |+... +......+++++| -++.+.|++++
T Consensus 174 ~~~~~~~~~~g~pDG~~vD~~G~l~va~~~~~~I~~~~p~-G~~~~~i~~p~~~~t~~~fgg~~~~~L~vTt 244 (246)
T PF08450_consen 174 RVFIDFPGGPGYPDGLAVDSDGNLWVADWGGGRIVVFDPD-GKLLREIELPVPRPTNCAFGGPDGKTLYVTT 244 (246)
T ss_dssp EEEEE-SSSSCEEEEEEEBTTS-EEEEEETTTEEEEEETT-SCEEEEEE-SSSSEEEEEEESTTSSEEEEEE
T ss_pred eeEEEcCCCCcCCCcceEcCCCCEEEEEcCCCEEEEECCC-ccEEEEEcCCCCCEEEEEEECCCCCEEEEEe
Confidence 112221 2 247789999999988887788999999988 66533 3333358999999 57778777664
No 281
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.66 E-value=2.3e-06 Score=74.41 Aligned_cols=171 Identities=16% Similarity=0.343 Sum_probs=112.7
Q ss_pred eEEEEecCCCEEEEEE-----------CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec--CCcEE
Q 018806 103 QGVSWHQHKHIVAFIS-----------GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC--KGGIC 169 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s-----------~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~--d~~v~ 169 (350)
..+.|++.|++|++-- .+..+.|+++. +..+... .+-.++|..++|.|.++++++++. +-.+.
T Consensus 226 ~qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~---e~~i~V~-~~~~~pVhdf~W~p~S~~F~vi~g~~pa~~s 301 (561)
T COG5354 226 VQLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRIT---ERSIPVE-KDLKDPVHDFTWEPLSSRFAVISGYMPASVS 301 (561)
T ss_pred cEEEEecCCceEEEEEEEeeecccceeccceEEEEeec---cccccee-ccccccceeeeecccCCceeEEeccccccee
Confidence 4567889998877631 13456777774 2222222 245789999999999888887764 58888
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC--CeEEEEeCCCCCc
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES--SSFTIWDVAQGLG 247 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--g~i~iwd~~~~~~ 247 (350)
++|++.. ... .+. ...=..+.|+|.+++++.++.++ |.+.+||......
T Consensus 302 ~~~lr~N--l~~------------------------~~P---e~~rNT~~fsp~~r~il~agF~nl~gni~i~~~~~rf~ 352 (561)
T COG5354 302 VFDLRGN--LRF------------------------YFP---EQKRNTIFFSPHERYILFAGFDNLQGNIEIFDPAGRFK 352 (561)
T ss_pred ecccccc--eEE------------------------ecC---CcccccccccCcccEEEEecCCccccceEEeccCCceE
Confidence 8888721 110 011 12345688999999999987765 6899999876543
Q ss_pred eeeeecCCCeEEEEEcCCCCEEEEEe------cCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEE
Q 018806 248 TPIRRGFGGLSILKWSPTGDYFFAAK------FDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 248 ~~~~~~~~~v~~~~~sp~g~~l~~~~------~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
..-.-......-+.|+|||+++.+.. .|..++|||+...+.- ..+.+.|.|.|++..+.
T Consensus 353 ~~~~~~~~n~s~~~wspd~qF~~~~~ts~k~~~Dn~i~l~~v~g~~~f-------el~~~~W~p~~~~~tts 417 (561)
T COG5354 353 VAGAFNGLNTSYCDWSPDGQFYDTDTTSEKLRVDNSIKLWDVYGAKVF-------ELTNITWDPSGQYVTTS 417 (561)
T ss_pred EEEEeecCCceEeeccCCceEEEecCCCcccccCcceEEEEecCchhh-------hhhhccccCCcccceee
Confidence 33122234455678999999987653 3788999999765443 34556666666665544
No 282
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=98.64 E-value=1.5e-05 Score=78.02 Aligned_cols=195 Identities=18% Similarity=0.282 Sum_probs=120.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccC-------------CC--------CCceeEe---------------cC--
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYED-------------SE--------GKDACIL---------------TS-- 141 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~-------------~~--------~~~~~~~---------------~~-- 141 (350)
..|.+++||||+..||.++.++++.+..-+- +. |++..++ ..
T Consensus 121 ~GI~a~~WSPD~Ella~vT~~~~l~~mt~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~ 200 (928)
T PF04762_consen 121 SGILAASWSPDEELLALVTGEGNLLLMTRDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPK 200 (928)
T ss_pred CcEEEEEECCCcCEEEEEeCCCEEEEEeccceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCc
Confidence 4799999999999999999999888764320 00 0000000 00
Q ss_pred ------CCCCCeeEEEEeeCCCeEEEEec------CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccC
Q 018806 142 ------DSQRDVKVLEWRPNGGRSLSVGC------KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRS 209 (350)
Q Consensus 142 ------~~~~~v~~~~~sp~~~~l~~~~~------d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 209 (350)
..+..-..++|-.||+++++..- .+.++||+-+ + .... ...
T Consensus 201 ~d~~~~s~dd~~~~ISWRGDG~yFAVss~~~~~~~~R~iRVy~Re-G-~L~s-------------------------tSE 253 (928)
T PF04762_consen 201 VDEGKLSWDDGRVRISWRGDGEYFAVSSVEPETGSRRVIRVYSRE-G-ELQS-------------------------TSE 253 (928)
T ss_pred cccCccccCCCceEEEECCCCcEEEEEEEEcCCCceeEEEEECCC-c-eEEe-------------------------ccc
Confidence 02234567889999888777654 1578899876 1 1111 011
Q ss_pred CCCCceeeEEECCCCCeEEEEEeC--CCeEEEEeCCCCCceee--e--ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 210 QNGEQITALSWGPDGRYLASASYE--SSSFTIWDVAQGLGTPI--R--RGFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 210 ~~~~~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~~~~~~~~--~--~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
..++--.+++|.|.|..||+.-.. .-.|.+|.-+.-+.-.+ . .....+..+.|++|+..||..-.|. |.+|-.
T Consensus 254 ~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfErNGLrhgeF~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~-vqLWt~ 332 (928)
T PF04762_consen 254 PVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFERNGLRHGEFTLRFDPEEEKVIELAWNSDSEILAVWLEDR-VQLWTR 332 (928)
T ss_pred cCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEecCCcEeeeEecCCCCCCceeeEEEECCCCCEEEEEecCC-ceEEEe
Confidence 112344678999999999988651 12677777554332221 1 2346789999999999999877555 999988
Q ss_pred CCCce--ec-cc-cCCCCeEEEEEcCCCC-EEEEEEC-CCeEEEE
Q 018806 284 NTWTS--EP-WS-STSGFVTGATWDPEGR-MILLAFA-GSLTLGS 322 (350)
Q Consensus 284 ~~~~~--~~-~~-~~~~~v~~~~~s~~g~-~l~~~~~-~~~~~~~ 322 (350)
.+..- ++ +. .....+..+.|+|... .|.+.+. +....+.
T Consensus 333 ~NYHWYLKqei~~~~~~~~~~~~Wdpe~p~~L~v~t~~g~~~~~~ 377 (928)
T PF04762_consen 333 SNYHWYLKQEIRFSSSESVNFVKWDPEKPLRLHVLTSNGQYEIYD 377 (928)
T ss_pred eCCEEEEEEEEEccCCCCCCceEECCCCCCEEEEEecCCcEEEEE
Confidence 77653 22 22 2233445589999543 3555553 5543333
No 283
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=98.62 E-value=3.1e-06 Score=74.38 Aligned_cols=182 Identities=14% Similarity=0.187 Sum_probs=123.0
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-----------CcEEE
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-----------GGICI 170 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-----------~~v~i 170 (350)
=+-+.|||-|.+|++--..| |.+|-=.. -.....+ .|. .|.-+.|||+.++|++-+.. ..++|
T Consensus 213 etyv~wSP~GTYL~t~Hk~G-I~lWGG~~--f~r~~RF--~Hp-~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~I 286 (698)
T KOG2314|consen 213 ETYVRWSPKGTYLVTFHKQG-IALWGGES--FDRIQRF--YHP-GVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLII 286 (698)
T ss_pred eeeEEecCCceEEEEEeccc-eeeecCcc--HHHHHhc--cCC-CceeeecCCccceEEEecCCccccCcccCCCceEEE
Confidence 46789999999999987777 77997421 2333333 355 58999999997777775531 56899
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI 250 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~ 250 (350)
||+.++.....+.. +++.. ....-+.||.|++++|.-..+ .|.||+..+......
T Consensus 287 WDI~tG~lkrsF~~----------------------~~~~~-~~WP~frWS~DdKy~Arm~~~--sisIyEtpsf~lld~ 341 (698)
T KOG2314|consen 287 WDIATGLLKRSFPV----------------------IKSPY-LKWPIFRWSHDDKYFARMTGN--SISIYETPSFMLLDK 341 (698)
T ss_pred EEccccchhcceec----------------------cCCCc-cccceEEeccCCceeEEeccc--eEEEEecCceeeecc
Confidence 99996655444332 11111 223457899999999988776 799999876433322
Q ss_pred ee-cCCCeEEEEEcCCCCEEEEEec--C---CeEEEEeCCCCceecccc-CCCCeEEEEEcCCCCEEEEEE
Q 018806 251 RR-GFGGLSILKWSPTGDYFFAAKF--D---GTFYLWETNTWTSEPWSS-TSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 251 ~~-~~~~v~~~~~sp~g~~l~~~~~--d---~~v~iwd~~~~~~~~~~~-~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.. ...+|....|+|.++.||.-.. + ..+.+..+.++...+... +.-.-..+-|-.+|.+|++-.
T Consensus 342 Kslki~gIr~FswsP~~~llAYwtpe~~~~parvtL~evPs~~~iRt~nlfnVsDckLhWQk~gdyLcvkv 412 (698)
T KOG2314|consen 342 KSLKISGIRDFSWSPTSNLLAYWTPETNNIPARVTLMEVPSKREIRTKNLFNVSDCKLHWQKSGDYLCVKV 412 (698)
T ss_pred cccCCccccCcccCCCcceEEEEcccccCCcceEEEEecCccceeeeccceeeeccEEEeccCCcEEEEEE
Confidence 22 2367889999999999886533 1 367788887776643332 222234577889999998764
No 284
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.61 E-value=2.6e-07 Score=83.62 Aligned_cols=185 Identities=14% Similarity=0.239 Sum_probs=128.3
Q ss_pred cCeeEEEEecCC---CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEe-cCCcEEEEecCC
Q 018806 100 VDLQGVSWHQHK---HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVG-CKGGICIWAPSY 175 (350)
Q Consensus 100 ~~V~~v~~sp~g---~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~-~d~~v~iwd~~~ 175 (350)
-.|-.+.|||.. .++++.+. ....+|++.......+.....+|...|+.+.|+|...-+++.. .|-.+..||++.
T Consensus 68 w~vad~qws~h~a~~~wiVsts~-qkaiiwnlA~ss~~aIef~lhghsraitd~n~~~q~pdVlatcsvdt~vh~wd~rS 146 (1081)
T KOG0309|consen 68 WQVADVQWSPHPAKPYWIVSTSN-QKAIIWNLAKSSSNAIEFVLHGHSRAITDINFNPQHPDVLATCSVDTYVHAWDMRS 146 (1081)
T ss_pred chhcceecccCCCCceeEEecCc-chhhhhhhhcCCccceEEEEecCccceeccccCCCCCcceeeccccccceeeeccC
Confidence 368888998865 35555444 4455999987666666777779999999999998866555544 489999999985
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--eeeec
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--PIRRG 253 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~~~~~ 253 (350)
...+... ....+ .....++|+-....+.+.+..+ .|++||.+.+... .+.+|
T Consensus 147 p~~p~ys------------------------~~~w~-s~asqVkwnyk~p~vlasshg~-~i~vwd~r~gs~pl~s~K~~ 200 (1081)
T KOG0309|consen 147 PHRPFYS------------------------TSSWR-SAASQVKWNYKDPNVLASSHGN-DIFVWDLRKGSTPLCSLKGH 200 (1081)
T ss_pred CCcceee------------------------eeccc-ccCceeeecccCcchhhhccCC-ceEEEeccCCCcceEEeccc
Confidence 5433221 11112 4667899987544444445553 8999999987532 35556
Q ss_pred CCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEE
Q 018806 254 FGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMIL 311 (350)
Q Consensus 254 ~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~ 311 (350)
...+..+.|+.- ...+.+++.|++|++||...... ........+|+...|-|-|+-.+
T Consensus 201 vs~vn~~~fnr~~~s~~~s~~~d~tvkfw~y~kSt~e~~~~vtt~~piw~~r~~Pfg~g~~ 261 (1081)
T KOG0309|consen 201 VSSVNSIDFNRFKYSEIMSSSNDGTVKFWDYSKSTTESKRTVTTNFPIWRGRYLPFGEGYC 261 (1081)
T ss_pred ceeeehHHHhhhhhhhhcccCCCCceeeecccccccccceeccccCcceeccccccCceeE
Confidence 677888888753 33577888999999999976544 34555667888888888665433
No 285
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=98.61 E-value=2.7e-07 Score=79.51 Aligned_cols=174 Identities=16% Similarity=0.182 Sum_probs=118.3
Q ss_pred CeeEEEEecCCC-EEEEEECCCeEEEEEccCCCCCce----eE-----ecCCCCCCeeEEEEeeCCCeEEEEecCCcEEE
Q 018806 101 DLQGVSWHQHKH-IVAFISGSTQVIVRDYEDSEGKDA----CI-----LTSDSQRDVKVLEWRPNGGRSLSVGCKGGICI 170 (350)
Q Consensus 101 ~V~~v~~sp~g~-~la~~s~d~~i~iw~~~~~~~~~~----~~-----~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~i 170 (350)
...+++.+|... .+|+++.|..+++||...-..... .. +.....-.|++++++.++..++++-.|-.|++
T Consensus 283 ~L~~Ia~~P~nt~~faVgG~dqf~RvYD~R~~~~e~~n~~~~~f~p~hl~~d~~v~ITgl~Ysh~~sElLaSYnDe~IYL 362 (559)
T KOG1334|consen 283 GLYTIAVDPRNTNEFAVGGSDQFARVYDQRRIDKEENNGVLDKFCPHHLVEDDPVNITGLVYSHDGSELLASYNDEDIYL 362 (559)
T ss_pred eeeeEecCCCCccccccCChhhhhhhhcccchhhccccchhhhcCCccccccCcccceeEEecCCccceeeeecccceEE
Confidence 357788888654 888899999999998743222111 11 11123346999999999899999999999999
Q ss_pred EecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCC-CceeeEEE-CCCCCeEEEEEeCCCeEEEEeCCCCCce
Q 018806 171 WAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNG-EQITALSW-GPDGRYLASASYESSSFTIWDVAQGLGT 248 (350)
Q Consensus 171 wd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~v~~~~~-sp~g~~l~~~~~d~g~i~iwd~~~~~~~ 248 (350)
+.-..+.-....... + ..-.....+++|.+ ..|..+-| -|...++++|+.- |.|.||+-.+++.+
T Consensus 363 F~~~~~~G~~p~~~s---~---------~~~~~k~vYKGHrN~~TVKgVNFfGPrsEyVvSGSDC-GhIFiW~K~t~eii 429 (559)
T KOG1334|consen 363 FNKSMGDGSEPDPSS---P---------REQYVKRVYKGHRNSRTVKGVNFFGPRSEYVVSGSDC-GHIFIWDKKTGEII 429 (559)
T ss_pred eccccccCCCCCCCc---c---------hhhccchhhcccccccccceeeeccCccceEEecCcc-ceEEEEecchhHHH
Confidence 954422111110000 0 00011233677753 34667765 5778888888777 89999999999887
Q ss_pred eeeec-CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCc
Q 018806 249 PIRRG-FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWT 287 (350)
Q Consensus 249 ~~~~~-~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~ 287 (350)
.++.. ..-|.|+.=+|--..||+++-|..|+||-..+.+
T Consensus 430 ~~MegDr~VVNCLEpHP~~PvLAsSGid~DVKIWTP~~~e 469 (559)
T KOG1334|consen 430 RFMEGDRHVVNCLEPHPHLPVLASSGIDHDVKIWTPLTAE 469 (559)
T ss_pred HHhhcccceEeccCCCCCCchhhccCCccceeeecCCccc
Confidence 65544 4578899999999999999999999999774433
No 286
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=98.59 E-value=0.00015 Score=60.53 Aligned_cols=191 Identities=16% Similarity=0.267 Sum_probs=116.1
Q ss_pred EEEEec-CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEe-eCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 104 GVSWHQ-HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWR-PNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 104 ~v~~sp-~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~s-p~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
++.|.+ ++.++++-...+.|..|+... +. ...+. ... ...+++. ++ ..++++... .+.++|...+ ....
T Consensus 4 gp~~d~~~g~l~~~D~~~~~i~~~~~~~--~~-~~~~~--~~~-~~G~~~~~~~-g~l~v~~~~-~~~~~d~~~g-~~~~ 74 (246)
T PF08450_consen 4 GPVWDPRDGRLYWVDIPGGRIYRVDPDT--GE-VEVID--LPG-PNGMAFDRPD-GRLYVADSG-GIAVVDPDTG-KVTV 74 (246)
T ss_dssp EEEEETTTTEEEEEETTTTEEEEEETTT--TE-EEEEE--SSS-EEEEEEECTT-SEEEEEETT-CEEEEETTTT-EEEE
T ss_pred ceEEECCCCEEEEEEcCCCEEEEEECCC--Ce-EEEEe--cCC-CceEEEEccC-CEEEEEEcC-ceEEEecCCC-cEEE
Confidence 678998 666666655688898888753 32 22222 122 7778887 55 666666554 4555677632 1111
Q ss_pred eecccccccceecCCCCCceEEeeec--cCCCCCceeeEEECCCCCeEEEEEeCC-------CeEEEEeCCCCCceeeee
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFL--RSQNGEQITALSWGPDGRYLASASYES-------SSFTIWDVAQGLGTPIRR 252 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~v~~~~~sp~g~~l~~~~~d~-------g~i~iwd~~~~~~~~~~~ 252 (350)
.... ..+......++++.|+|+..++..... |.|..++.. ++...+..
T Consensus 75 ----------------------~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~ 131 (246)
T PF08450_consen 75 ----------------------LADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTVVAD 131 (246)
T ss_dssp ----------------------EEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEEEEE
T ss_pred ----------------------EeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEEEec
Confidence 1111 121235788999999999666654321 357778877 55555555
Q ss_pred cCCCeEEEEEcCCCCEEEE-EecCCeEEEEeCCCCc--e---eccc---cCCCCeEEEEEcCCCCEEEEEECCCeEEEEE
Q 018806 253 GFGGLSILKWSPTGDYFFA-AKFDGTFYLWETNTWT--S---EPWS---STSGFVTGATWDPEGRMILLAFAGSLTLGSI 323 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~-~~~d~~v~iwd~~~~~--~---~~~~---~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~ 323 (350)
.-.....++|+|+++.|+. -+..+.|..|++.... . ..+. ...+..-.+++..+|+..++.. ....+..+
T Consensus 132 ~~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~vD~~G~l~va~~-~~~~I~~~ 210 (246)
T PF08450_consen 132 GLGFPNGIAFSPDGKTLYVADSFNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAVDSDGNLWVADW-GGGRIVVF 210 (246)
T ss_dssp EESSEEEEEEETTSSEEEEEETTTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEEBTTS-EEEEEE-TTTEEEEE
T ss_pred CcccccceEECCcchheeecccccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceEcCCCCEEEEEc-CCCEEEEE
Confidence 5677889999999998764 4567889999986322 2 1121 2223478899999998766443 33466666
Q ss_pred EeCC
Q 018806 324 HFAS 327 (350)
Q Consensus 324 ~~~~ 327 (350)
+-..
T Consensus 211 ~p~G 214 (246)
T PF08450_consen 211 DPDG 214 (246)
T ss_dssp ETTS
T ss_pred CCCc
Confidence 6543
No 287
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=98.59 E-value=1.6e-07 Score=84.90 Aligned_cols=179 Identities=11% Similarity=0.165 Sum_probs=119.2
Q ss_pred cCeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..|+.+.|+|+. ..+|+++.|-.+..||+... .........-......++|+-....+++.+..+.|++||++.+..
T Consensus 115 raitd~n~~~q~pdVlatcsvdt~vh~wd~rSp--~~p~ys~~~w~s~asqVkwnyk~p~vlasshg~~i~vwd~r~gs~ 192 (1081)
T KOG0309|consen 115 RAITDINFNPQHPDVLATCSVDTYVHAWDMRSP--HRPFYSTSSWRSAASQVKWNYKDPNVLASSHGNDIFVWDLRKGST 192 (1081)
T ss_pred cceeccccCCCCCcceeeccccccceeeeccCC--CcceeeeecccccCceeeecccCcchhhhccCCceEEEeccCCCc
Confidence 358888898865 68899999999999999642 222222233445678899998778888888889999999996554
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc--eeeeecCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWDVAQGLG--TPIRRGFG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~--~~~~~~~~ 255 (350)
+ ...+++|. ..|..+.|..- ...+.+++.| |+|+.||...... ......+.
T Consensus 193 p------------------------l~s~K~~v-s~vn~~~fnr~~~s~~~s~~~d-~tvkfw~y~kSt~e~~~~vtt~~ 246 (1081)
T KOG0309|consen 193 P------------------------LCSLKGHV-SSVNSIDFNRFKYSEIMSSSND-GTVKFWDYSKSTTESKRTVTTNF 246 (1081)
T ss_pred c------------------------eEEecccc-eeeehHHHhhhhhhhhcccCCC-CceeeecccccccccceeccccC
Confidence 3 23355554 67788888653 3456777888 7999999876543 34445567
Q ss_pred CeEEEEEcCCCC--EEEEEecCCeEEEEeCCC---------Cce--eccccCCCCeEEEEEcCC
Q 018806 256 GLSILKWSPTGD--YFFAAKFDGTFYLWETNT---------WTS--EPWSSTSGFVTGATWDPE 306 (350)
Q Consensus 256 ~v~~~~~sp~g~--~l~~~~~d~~v~iwd~~~---------~~~--~~~~~~~~~v~~~~~s~~ 306 (350)
++..-++-|-|+ ++.-.-.+..+.+++-++ +.. ..+.+|...|....|-..
T Consensus 247 piw~~r~~Pfg~g~~~mp~~G~n~v~~~~c~n~d~e~n~~~~~~pVh~F~GH~D~V~eFlWR~r 310 (1081)
T KOG0309|consen 247 PIWRGRYLPFGEGYCIMPMVGGNMVPQLRCENSDLEWNVFDLNTPVHTFVGHDDVVLEFLWRKR 310 (1081)
T ss_pred cceeccccccCceeEeccccCCeeeeeccccchhhhhccccCCcceeeecCcchHHHHHhhhhc
Confidence 788888888544 332222223444444332 221 456788887766666443
No 288
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=98.55 E-value=5e-06 Score=68.92 Aligned_cols=187 Identities=13% Similarity=0.158 Sum_probs=128.3
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCC-CCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSE-GKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~-~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
..+++++++++....|+.|-..|++.-+.+...- ..........|...+..+-|+-..+.+++.+.|..+.---.+.+.
T Consensus 68 P~~~~~~~y~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~ 147 (404)
T KOG1409|consen 68 PSPCSAMEYVSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGN 147 (404)
T ss_pred CCCceEeeeeccceEEEEEEecceEEEEEhhhhhhhcchhhhhhhhhcceeeEEecCCceeEEEeccccceEEEeeccCC
Confidence 4579999999999999999999999877664211 111122223689999999998776788888888665433333222
Q ss_pred CCc--eeecccccc--cceecCCCCCc------------eEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEe
Q 018806 178 NAA--SVRSGAASF--LGALSRGPGTR------------WTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWD 241 (350)
Q Consensus 178 ~~~--~~~~~~~~~--~~~~~~~~~~~------------~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd 241 (350)
... .+....... +....+..+.. ..++..+.+|. +.+.+++|.|..+.|.++..|. .+.+||
T Consensus 148 ~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~~~~h~-~~~~~l~Wd~~~~~LfSg~~d~-~vi~wd 225 (404)
T KOG1409|consen 148 RLGGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITTFNGHT-GEVTCLKWDPGQRLLFSGASDH-SVIMWD 225 (404)
T ss_pred cccceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEEEcCcc-cceEEEEEcCCCcEEEeccccC-ceEEEe
Confidence 111 111111111 11122222211 12445677887 7999999999999999999995 999999
Q ss_pred CCCCCc--eeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCc
Q 018806 242 VAQGLG--TPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWT 287 (350)
Q Consensus 242 ~~~~~~--~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~ 287 (350)
+...+. .....|...|..++..+--+.+.+++.||.|.+||++...
T Consensus 226 igg~~g~~~el~gh~~kV~~l~~~~~t~~l~S~~edg~i~~w~mn~~r 273 (404)
T KOG1409|consen 226 IGGRKGTAYELQGHNDKVQALSYAQHTRQLISCGEDGGIVVWNMNVKR 273 (404)
T ss_pred ccCCcceeeeeccchhhhhhhhhhhhheeeeeccCCCeEEEEecccee
Confidence 976554 3466788888888888888889999999999999997543
No 289
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.54 E-value=1.5e-05 Score=73.32 Aligned_cols=178 Identities=17% Similarity=0.225 Sum_probs=122.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.++|++++ ++.++.|+-+|.+++.+.. +.. ... ..|... .-+|+++++++.||+|.|-.+.+.....
T Consensus 41 ~is~~av~--~~~~~~GtH~g~v~~~~~~---~~~-~~~-~~~s~~------~~~Gey~asCS~DGkv~I~sl~~~~~~~ 107 (846)
T KOG2066|consen 41 AISCCAVH--DKFFALGTHRGAVYLTTCQ---GNP-KTN-FDHSSS------ILEGEYVASCSDDGKVVIGSLFTDDEIT 107 (846)
T ss_pred HHHHHHhh--cceeeeccccceEEEEecC---Ccc-ccc-cccccc------ccCCceEEEecCCCcEEEeeccCCccce
Confidence 45555554 5789999999999999975 322 222 234433 5678899999999999998877554432
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-----CCeEEEEEeCCCeEEEEeCCC---CCceeeee
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-----GRYLASASYESSSFTIWDVAQ---GLGTPIRR 252 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-----g~~l~~~~~d~g~i~iwd~~~---~~~~~~~~ 252 (350)
...- ..++.+++++|+ .+++++|+.. | +.++.-+- ........
T Consensus 108 ~~df---------------------------~rpiksial~Pd~~~~~sk~fv~GG~a-g-lvL~er~wlgnk~~v~l~~ 158 (846)
T KOG2066|consen 108 QYDF---------------------------KRPIKSIALHPDFSRQQSKQFVSGGMA-G-LVLSERNWLGNKDSVVLSE 158 (846)
T ss_pred eEec---------------------------CCcceeEEeccchhhhhhhheeecCcc-e-EEEehhhhhcCccceeeec
Confidence 2211 258899999997 5678888877 6 77775432 12223445
Q ss_pred cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-------cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEE
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-------STSGFVTGATWDPEGRMILLAFAGSLTLGSIH 324 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-------~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~ 324 (350)
..++|.++.|. |.+||-++.+| |+|||+.+++..... ..+.....+.|.++.+. +.|-+..+.+..++
T Consensus 159 ~eG~I~~i~W~--g~lIAWand~G-v~vyd~~~~~~l~~i~~p~~~~R~e~fpphl~W~~~~~L-VIGW~d~v~i~~I~ 233 (846)
T KOG2066|consen 159 GEGPIHSIKWR--GNLIAWANDDG-VKVYDTPTRQRLTNIPPPSQSVRPELFPPHLHWQDEDRL-VIGWGDSVKICSIK 233 (846)
T ss_pred CccceEEEEec--CcEEEEecCCC-cEEEeccccceeeccCCCCCCCCcccCCCceEecCCCeE-EEecCCeEEEEEEe
Confidence 67999999994 77888887766 999999988764322 11223456788886654 45767777777777
No 290
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=98.53 E-value=3.4e-05 Score=67.34 Aligned_cols=208 Identities=13% Similarity=0.119 Sum_probs=117.3
Q ss_pred cCeeEEEEecCCCEEEEEECC---------------CeEEEEEccCCCCCceeEecCCCCCC--ee-EEEEeeCCCeEEE
Q 018806 100 VDLQGVSWHQHKHIVAFISGS---------------TQVIVRDYEDSEGKDACILTSDSQRD--VK-VLEWRPNGGRSLS 161 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d---------------~~i~iw~~~~~~~~~~~~~~~~~~~~--v~-~~~~sp~~~~l~~ 161 (350)
.+|..+.|||.+++|.+=+.. ..+.+||... +..+... .....+ .+ -+.|+-++.+.+-
T Consensus 72 ~~V~~~~fSP~~kYL~tw~~~pi~~pe~e~sp~~~~n~~~vwd~~s--g~iv~sf-~~~~q~~~~Wp~~k~s~~D~y~AR 148 (561)
T COG5354 72 PDVKYLDFSPNEKYLVTWSREPIIEPEIEISPFTSKNNVFVWDIAS--GMIVFSF-NGISQPYLGWPVLKFSIDDKYVAR 148 (561)
T ss_pred CCceecccCcccceeeeeccCCccChhhccCCccccCceeEEeccC--ceeEeec-cccCCcccccceeeeeecchhhhh
Confidence 359999999999999985543 2488999853 4443333 232223 44 6789888544433
Q ss_pred EecCCcEEEEecCCCCCCceeecccccccceecCCCCCc---eEEe--------------e-----eccCCC--CCceee
Q 018806 162 VGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTR---WTLV--------------D-----FLRSQN--GEQITA 217 (350)
Q Consensus 162 ~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~---~~~~--------------~-----~~~~~~--~~~v~~ 217 (350)
-....++|+++...-....+.......+..+++++.+. +..+ . .+..++ ...=..
T Consensus 149 -vv~~sl~i~e~t~n~~~~p~~~lr~~gi~dFsisP~~n~~~la~~tPEk~~kpa~~~i~sIp~~s~l~tk~lfk~~~~q 227 (561)
T COG5354 149 -VVGSSLYIHEITDNIEEHPFKNLRPVGILDFSISPEGNHDELAYWTPEKLNKPAMVRILSIPKNSVLVTKNLFKVSGVQ 227 (561)
T ss_pred -hccCeEEEEecCCccccCchhhccccceeeEEecCCCCCceEEEEccccCCCCcEEEEEEccCCCeeeeeeeEeecccE
Confidence 35577889886311111222222222233333333311 1111 1 011110 011236
Q ss_pred EEECCCCCeEEEEEe-----------CCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe--cCCeEEEEeCC
Q 018806 218 LSWGPDGRYLASASY-----------ESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK--FDGTFYLWETN 284 (350)
Q Consensus 218 ~~~sp~g~~l~~~~~-----------d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~--~d~~v~iwd~~ 284 (350)
+.|.+.|++|++-.. ++ .++++++............++|...+|.|.++.+++.+ ..-.+.++|++
T Consensus 228 LkW~~~g~~ll~l~~t~~ksnKsyfges-nLyl~~~~e~~i~V~~~~~~pVhdf~W~p~S~~F~vi~g~~pa~~s~~~lr 306 (561)
T COG5354 228 LKWQVLGKYLLVLVMTHTKSNKSYFGES-NLYLLRITERSIPVEKDLKDPVHDFTWEPLSSRFAVISGYMPASVSVFDLR 306 (561)
T ss_pred EEEecCCceEEEEEEEeeecccceeccc-eEEEEeecccccceeccccccceeeeecccCCceeEEecccccceeecccc
Confidence 789999998765321 22 68888888554443335578999999999988876554 57788999988
Q ss_pred CCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 285 TWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 285 ~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.. + .+......=..+.|+|.++++++++
T Consensus 307 ~N-l-~~~~Pe~~rNT~~fsp~~r~il~ag 334 (561)
T COG5354 307 GN-L-RFYFPEQKRNTIFFSPHERYILFAG 334 (561)
T ss_pred cc-e-EEecCCcccccccccCcccEEEEec
Confidence 75 2 2222222223445566666655543
No 291
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.50 E-value=4.1e-06 Score=70.69 Aligned_cols=112 Identities=20% Similarity=0.138 Sum_probs=77.6
Q ss_pred ceeeEEECCCCCeEEEEEeC--CCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee--
Q 018806 214 QITALSWGPDGRYLASASYE--SSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-- 289 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-- 289 (350)
..+++.|-.+......+..- ...+.+|....+....+.+|-.-++.++|+||+++|+++..|..|+|-.+...-..
T Consensus 109 ~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~~~~~~~~lGhvSml~dVavS~D~~~IitaDRDEkIRvs~ypa~f~Ies 188 (390)
T KOG3914|consen 109 RPTAISFIREDTSVLVADKAGDVYSFDILSADSGRCEPILGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYPATFVIES 188 (390)
T ss_pred CcceeeeeeccceEEEEeecCCceeeeeecccccCcchhhhhhhhhheeeecCCCCEEEEecCCceEEEEecCcccchhh
Confidence 34555555554444443322 23566666666778889999999999999999999999999999999888765442
Q ss_pred ccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 290 PWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 290 ~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
-..+|...|..++.-++. .|++++ ++..++.|++.+
T Consensus 189 fclGH~eFVS~isl~~~~-~LlS~s-GD~tlr~Wd~~s 224 (390)
T KOG3914|consen 189 FCLGHKEFVSTISLTDNY-LLLSGS-GDKTLRLWDITS 224 (390)
T ss_pred hccccHhheeeeeeccCc-eeeecC-CCCcEEEEeccc
Confidence 345899999999988754 455443 333455555443
No 292
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.50 E-value=5.8e-07 Score=51.18 Aligned_cols=38 Identities=34% Similarity=0.827 Sum_probs=34.2
Q ss_pred EEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEe
Q 018806 202 TLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWD 241 (350)
Q Consensus 202 ~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd 241 (350)
.+...+.+|. +.|.+++|+|++++|++++.| ++|++||
T Consensus 2 ~~~~~~~~h~-~~i~~i~~~~~~~~~~s~~~D-~~i~vwd 39 (39)
T PF00400_consen 2 KCVRTFRGHS-SSINSIAWSPDGNFLASGSSD-GTIRVWD 39 (39)
T ss_dssp EEEEEEESSS-SSEEEEEEETTSSEEEEEETT-SEEEEEE
T ss_pred eEEEEEcCCC-CcEEEEEEecccccceeeCCC-CEEEEEC
Confidence 4567788886 799999999999999999999 6999997
No 293
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=98.47 E-value=0.00014 Score=62.84 Aligned_cols=111 Identities=18% Similarity=0.246 Sum_probs=57.9
Q ss_pred eeEEECCCCCeEEEEEe-CCC---eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCC---------------
Q 018806 216 TALSWGPDGRYLASASY-ESS---SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDG--------------- 276 (350)
Q Consensus 216 ~~~~~sp~g~~l~~~~~-d~g---~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--------------- 276 (350)
..=-|.|||..|..-+. .+| .|.-+|..+++...+..- .....+.-++||++++.=+.|.
T Consensus 241 gHEfw~~DG~~i~y~~~~~~~~~~~i~~~d~~t~~~~~~~~~-p~~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~~~~ 319 (386)
T PF14583_consen 241 GHEFWVPDGSTIWYDSYTPGGQDFWIAGYDPDTGERRRLMEM-PWCSHFMSSPDGKLFVGDGGDAPVDVADAGGYKIEND 319 (386)
T ss_dssp EEEEE-TTSS-EEEEEEETTT--EEEEEE-TTT--EEEEEEE--SEEEEEE-TTSSEEEEEE------------------
T ss_pred ccccccCCCCEEEEEeecCCCCceEEEeeCCCCCCceEEEeC-CceeeeEEcCCCCEEEecCCCCCccccccccceecCC
Confidence 33457788877766443 112 566677777655443322 2445666688998876433331
Q ss_pred -eEEEEeCCCCceeccccCC---------C--CeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCC
Q 018806 277 -TFYLWETNTWTSEPWSSTS---------G--FVTGATWDPEGRMILLAF--AGSLTLGSIHFAS 327 (350)
Q Consensus 277 -~v~iwd~~~~~~~~~~~~~---------~--~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~ 327 (350)
-|++++++.++...+..|. . .=-.+.|+|||++|++.+ .+...+|.+.+..
T Consensus 320 p~i~~~~~~~~~~~~l~~h~~sw~v~~~~~q~~hPhp~FSPDgk~VlF~Sd~~G~~~vY~v~i~~ 384 (386)
T PF14583_consen 320 PWIYLFDVEAGRFRKLARHDTSWKVLDGDRQVTHPHPSFSPDGKWVLFRSDMEGPPAVYLVEIPD 384 (386)
T ss_dssp -EEEEEETTTTEEEEEEE-------BTTBSSTT----EE-TTSSEEEEEE-TTSS-EEEEEE--C
T ss_pred cEEEEeccccCceeeeeeccCcceeecCCCccCCCCCccCCCCCEEEEECCCCCCccEEEEeCcc
Confidence 5777888877654333321 1 124679999999999988 4446777777653
No 294
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=98.47 E-value=2.2e-06 Score=73.37 Aligned_cols=215 Identities=10% Similarity=0.048 Sum_probs=137.7
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCceeec----
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAASVRS---- 184 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~~~~---- 184 (350)
-.+++.+++.||.++.|.-..-.+......+..|-..|.+++.+-++-.+.+.+. |..++++|++.-.-..-+..
T Consensus 19 ka~fiiqASlDGh~KFWkKs~isGvEfVKhFraHL~~I~sl~~S~dg~L~~Sv~d~Dhs~KvfDvEn~DminmiKL~~lP 98 (558)
T KOG0882|consen 19 KAKFIIQASLDGHKKFWKKSRISGVEFVKHFRAHLGVILSLAVSYDGWLFRSVEDPDHSVKVFDVENFDMINMIKLVDLP 98 (558)
T ss_pred hhheEEeeecchhhhhcCCCCccceeehhhhHHHHHHHHhhhccccceeEeeccCcccceeEEEeeccchhhhcccccCC
Confidence 4578999999999999986532444444444568889999999999655555566 79999999873221111110
Q ss_pred -------ccccccceecCC--CCCceEEee---------eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-
Q 018806 185 -------GAASFLGALSRG--PGTRWTLVD---------FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG- 245 (350)
Q Consensus 185 -------~~~~~~~~~~~~--~~~~~~~~~---------~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~- 245 (350)
........++.+ ..+...+++ .+.+-+..+|..+.+.|-+..+++.... |.|.-|.....
T Consensus 99 g~a~wv~skGd~~s~IAVs~~~sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~qa~Ds~vSiD~~-gmVEyWs~e~~~ 177 (558)
T KOG0882|consen 99 GFAEWVTSKGDKISLIAVSLFKSGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQAGDSAVSIDIS-GMVEYWSAEGPF 177 (558)
T ss_pred CceEEecCCCCeeeeEEeecccCCCcEEECCcCCcCccceecccccCceEEEEeeccccceeecccc-ceeEeecCCCcc
Confidence 011111111111 112222221 2233234789999999999988888777 79999988731
Q ss_pred -----Cce-------ee---eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc------------------
Q 018806 246 -----LGT-------PI---RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS------------------ 292 (350)
Q Consensus 246 -----~~~-------~~---~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~------------------ 292 (350)
... .+ ...+....++.|+|+|..+.+-+.|..|+++++++++..+..
T Consensus 178 qfPr~~l~~~~K~eTdLy~f~K~Kt~pts~Efsp~g~qistl~~DrkVR~F~~KtGklvqeiDE~~t~~~~q~ks~y~l~ 257 (558)
T KOG0882|consen 178 QFPRTNLNFELKHETDLYGFPKAKTEPTSFEFSPDGAQISTLNPDRKVRGFVFKTGKLVQEIDEVLTDAQYQPKSPYGLM 257 (558)
T ss_pred cCccccccccccccchhhcccccccCccceEEccccCcccccCcccEEEEEEeccchhhhhhhccchhhhhccccccccc
Confidence 010 01 122356789999999999999999999999999998752211
Q ss_pred ---------------cCC-CCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 293 ---------------STS-GFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 293 ---------------~~~-~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.+. ..-+.+.|...|++|+.++--.+.+..++.
T Consensus 258 ~VelgRRmaverelek~~~~~~~~~~fdes~~flly~t~~gikvin~~t 306 (558)
T KOG0882|consen 258 HVELGRRMAVERELEKHGSTVGTNAVFDESGNFLLYGTILGIKVINLDT 306 (558)
T ss_pred eeehhhhhhHHhhHhhhcCcccceeEEcCCCCEEEeecceeEEEEEeec
Confidence 111 234678899999999998644445554443
No 295
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=98.47 E-value=0.00021 Score=59.92 Aligned_cols=199 Identities=21% Similarity=0.222 Sum_probs=123.6
Q ss_pred eeEEEEec-CCCEEEEEECCCe-EEEEEccCCCCCceeEecCCCCC-CeeEEEEeeCCCeEEEEecC-----CcEEEEec
Q 018806 102 LQGVSWHQ-HKHIVAFISGSTQ-VIVRDYEDSEGKDACILTSDSQR-DVKVLEWRPNGGRSLSVGCK-----GGICIWAP 173 (350)
Q Consensus 102 V~~v~~sp-~g~~la~~s~d~~-i~iw~~~~~~~~~~~~~~~~~~~-~v~~~~~sp~~~~l~~~~~d-----~~v~iwd~ 173 (350)
...++.+| ++..++++-.-|+ ..+||..+ ++....+...... ---.-.||+||+.|+++-.| |.|-|||.
T Consensus 7 gH~~a~~p~~~~avafaRRPG~~~~v~D~~~--g~~~~~~~a~~gRHFyGHg~fs~dG~~LytTEnd~~~g~G~IgVyd~ 84 (305)
T PF07433_consen 7 GHGVAAHPTRPEAVAFARRPGTFALVFDCRT--GQLLQRLWAPPGRHFYGHGVFSPDGRLLYTTENDYETGRGVIGVYDA 84 (305)
T ss_pred ccceeeCCCCCeEEEEEeCCCcEEEEEEcCC--CceeeEEcCCCCCEEecCEEEcCCCCEEEEeccccCCCcEEEEEEEC
Confidence 45678888 5566777766654 45677743 5544444321111 11245799999888887554 88999999
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe------CCC-----------e
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY------ESS-----------S 236 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~------d~g-----------~ 236 (350)
. .+ +..+..+..+- -....+.+.|||+.|+.+.. |.| .
T Consensus 85 ~-~~-----------------------~~ri~E~~s~G-IGPHel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~ps 139 (305)
T PF07433_consen 85 A-RG-----------------------YRRIGEFPSHG-IGPHELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPS 139 (305)
T ss_pred c-CC-----------------------cEEEeEecCCC-cChhhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCc
Confidence 8 11 11233344442 35577889999988887632 111 4
Q ss_pred EEEEeCCCCCceee-----eecCCCeEEEEEcCCCCEEEEEecCC-------eEEEEeCCCC-ce-----eccccCCCCe
Q 018806 237 FTIWDVAQGLGTPI-----RRGFGGLSILKWSPTGDYFFAAKFDG-------TFYLWETNTW-TS-----EPWSSTSGFV 298 (350)
Q Consensus 237 i~iwd~~~~~~~~~-----~~~~~~v~~~~~sp~g~~l~~~~~d~-------~v~iwd~~~~-~~-----~~~~~~~~~v 298 (350)
+...|..+|+.... ..|.-.+..+++.++|..++..-..+ -|.+++.... +. ..+....+.+
T Consensus 140 L~~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~qg~~~~~~PLva~~~~g~~~~~~~~p~~~~~~l~~Y~ 219 (305)
T PF07433_consen 140 LVYLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFAMQYQGDPGDAPPLVALHRRGGALRLLPAPEEQWRRLNGYI 219 (305)
T ss_pred eEEEecCCCceeeeeecCccccccceeeEEecCCCcEEEEEecCCCCCccCCeEEEEcCCCcceeccCChHHHHhhCCce
Confidence 55667777765433 12456799999999997666554333 2444443331 11 1123456789
Q ss_pred EEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 299 TGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 299 ~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
-+|+++++|.++++++-....+..|+...
T Consensus 220 gSIa~~~~g~~ia~tsPrGg~~~~~d~~t 248 (305)
T PF07433_consen 220 GSIAADRDGRLIAVTSPRGGRVAVWDAAT 248 (305)
T ss_pred EEEEEeCCCCEEEEECCCCCEEEEEECCC
Confidence 99999999999999986666777776544
No 296
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=98.47 E-value=4.5e-05 Score=73.33 Aligned_cols=207 Identities=14% Similarity=0.270 Sum_probs=126.0
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCC----
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSY---- 175 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~---- 175 (350)
..|.++.|..++..|+.+...|.|.+-|..+ .. ..+...-...|.+++||||.+.++.....+++.+-+-..
T Consensus 69 ~~i~s~~fl~d~~~i~v~~~~G~iilvd~et--~~--~eivg~vd~GI~aaswS~Dee~l~liT~~~tll~mT~~f~~i~ 144 (1265)
T KOG1920|consen 69 DEIVSVQFLADTNSICVITALGDIILVDPET--LE--LEIVGNVDNGISAASWSPDEELLALITGRQTLLFMTKDFEPIA 144 (1265)
T ss_pred cceEEEEEecccceEEEEecCCcEEEEcccc--cc--eeeeeeccCceEEEeecCCCcEEEEEeCCcEEEEEeccccchh
Confidence 3699999999999999999999999988753 22 222223567899999999988777777777776654421
Q ss_pred CCCC-------ceeecccccc-cceecCCCCCceEEeeecc-----C--CCCCceeeEEECCCCCeEEEEEe----CCCe
Q 018806 176 PGNA-------ASVRSGAASF-LGALSRGPGTRWTLVDFLR-----S--QNGEQITALSWGPDGRYLASASY----ESSS 236 (350)
Q Consensus 176 ~~~~-------~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~-----~--~~~~~v~~~~~sp~g~~l~~~~~----d~g~ 236 (350)
.+.. ..+....+.. .+.|..+.. +-...+.+. + .....=+++.|--||+++++... +...
T Consensus 145 E~~L~~d~~~~sk~v~VGwGrkeTqfrgs~g-r~~~~~~~~~ek~~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~Rk 223 (1265)
T KOG1920|consen 145 EKPLDADDERKSKFVNVGWGRKETQFRGSEG-RQAARQKIEKEKALEQIEQDDHKTSISWRGDGEYFAVSFVESETGTRK 223 (1265)
T ss_pred ccccccccccccccceecccccceeeecchh-hhcccccccccccccchhhccCCceEEEccCCcEEEEEEEeccCCcee
Confidence 1111 0011111111 111111111 000000000 0 00123357999999999998432 2038
Q ss_pred EEEEeCCCCCceeeeec-CCCeEEEEEcCCCCEEEEEe---cCCeEEEEeCCCCce----eccccCCCCeEEEEEcCCCC
Q 018806 237 FTIWDVAQGLGTPIRRG-FGGLSILKWSPTGDYFFAAK---FDGTFYLWETNTWTS----EPWSSTSGFVTGATWDPEGR 308 (350)
Q Consensus 237 i~iwd~~~~~~~~~~~~-~~~v~~~~~sp~g~~l~~~~---~d~~v~iwd~~~~~~----~~~~~~~~~v~~~~~s~~g~ 308 (350)
|++||.+ |........ .+--.+++|-|.|.++++-. .|+.|.+|.-+.-.. .++......+..++|+.++.
T Consensus 224 irV~drE-g~Lns~se~~~~l~~~LsWkPsgs~iA~iq~~~sd~~IvffErNGL~hg~f~l~~p~de~~ve~L~Wns~sd 302 (1265)
T KOG1920|consen 224 IRVYDRE-GALNSTSEPVEGLQHSLSWKPSGSLIAAIQCKTSDSDIVFFERNGLRHGEFVLPFPLDEKEVEELAWNSNSD 302 (1265)
T ss_pred EEEeccc-chhhcccCcccccccceeecCCCCeEeeeeecCCCCcEEEEecCCccccccccCCcccccchheeeecCCCC
Confidence 9999987 544333322 23445799999999998763 356798987654333 23334445599999999999
Q ss_pred EEEE
Q 018806 309 MILL 312 (350)
Q Consensus 309 ~l~~ 312 (350)
.|++
T Consensus 303 iLAv 306 (1265)
T KOG1920|consen 303 ILAV 306 (1265)
T ss_pred ceee
Confidence 9988
No 297
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=98.47 E-value=1.3e-06 Score=79.07 Aligned_cols=159 Identities=11% Similarity=0.211 Sum_probs=116.3
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG 221 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s 221 (350)
+......++.|+...+.++++|.||.+++..+.+...-...... .......+.+++.||+ +.|.-+.|+
T Consensus 12 PnnvkL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~gl----------aa~snLsmNQtLeGH~-~sV~vvTWN 80 (1189)
T KOG2041|consen 12 PNNVKLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGL----------AAASNLSMNQTLEGHN-ASVMVVTWN 80 (1189)
T ss_pred CCCceEEEEEEcccCCeEEeccccceeEEEEccccCCccccccc----------ccccccchhhhhccCc-ceEEEEEec
Confidence 34567899999999788888888999999988743322111110 0112344567899997 799999999
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCcee-eee--cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCC
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLGTP-IRR--GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSG 296 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~--~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~ 296 (350)
.+.+.|.++..+ |-|.+|-+-.+.... +.. .+.-|.+++|+.||..|+..-.||.|-+=.++.... +.+.+ .
T Consensus 81 e~~QKLTtSDt~-GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGavIVGsvdGNRIwgKeLkg--~ 157 (1189)
T KOG2041|consen 81 ENNQKLTTSDTS-GLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGAVIVGSVDGNRIWGKELKG--Q 157 (1189)
T ss_pred cccccccccCCC-ceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCCEEEEeeccceecchhcch--h
Confidence 999999888777 899999998886532 322 346688999999999999999999888877776554 22322 2
Q ss_pred CeEEEEEcCCCCEEEEEE
Q 018806 297 FVTGATWDPEGRMILLAF 314 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~ 314 (350)
....+.|++|.+.++++-
T Consensus 158 ~l~hv~ws~D~~~~Lf~~ 175 (1189)
T KOG2041|consen 158 LLAHVLWSEDLEQALFKK 175 (1189)
T ss_pred eccceeecccHHHHHhhh
Confidence 245788999988877764
No 298
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=98.46 E-value=1.5e-05 Score=67.59 Aligned_cols=221 Identities=10% Similarity=0.071 Sum_probs=122.0
Q ss_pred ccCeeEEEEecCCC-EEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCC
Q 018806 99 EVDLQGVSWHQHKH-IVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYP 176 (350)
Q Consensus 99 ~~~V~~v~~sp~g~-~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~ 176 (350)
+..|.+++|||..+ ++..++.+.+|+|.|+++ ....... ..+ ..+++++|.-|..+++++|. .|.|.|||++..
T Consensus 193 g~~IrdlafSp~~~GLl~~asl~nkiki~dlet--~~~vssy-~a~-~~~wSC~wDlde~h~IYaGl~nG~VlvyD~R~~ 268 (463)
T KOG1645|consen 193 GSFIRDLAFSPFNEGLLGLASLGNKIKIMDLET--SCVVSSY-IAY-NQIWSCCWDLDERHVIYAGLQNGMVLVYDMRQP 268 (463)
T ss_pred chhhhhhccCccccceeeeeccCceEEEEeccc--ceeeehe-ecc-CCceeeeeccCCcceeEEeccCceEEEEEccCC
Confidence 45799999999887 788899999999999964 2222222 234 78999999999888888887 599999999865
Q ss_pred CCCceeec--ccccccceecCCCCCc-----------------eEEee-------eccCCCCCceeeEEECCCCCeEEEE
Q 018806 177 GNAASVRS--GAASFLGALSRGPGTR-----------------WTLVD-------FLRSQNGEQITALSWGPDGRYLASA 230 (350)
Q Consensus 177 ~~~~~~~~--~~~~~~~~~~~~~~~~-----------------~~~~~-------~~~~~~~~~v~~~~~sp~g~~l~~~ 230 (350)
.....-.. ....++..++.-+..+ |.... ++.-...+...+++..+-.++++..
T Consensus 269 ~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt~l~f~ei~~s~~~~p~vlele~pG~cismqy~~~snh~l~t 348 (463)
T KOG1645|consen 269 EGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALTVLQFYEIVFSAECLPCVLELEPPGICISMQYHGVSNHLLLT 348 (463)
T ss_pred CchHhhhhhhhccCcceeecccCccccccccceEEeeehhhhhhhhhccccCCCcccccCCCcceeeeeecCccceEEEE
Confidence 43321111 1222222211111110 11000 0111112455666666655665554
Q ss_pred EeCCC------eEEE-EeCCCCCcee--eeecCC----Ce--EEEEE-cCCCCEEE-EEecCCeEEEEeCCCCceecccc
Q 018806 231 SYESS------SFTI-WDVAQGLGTP--IRRGFG----GL--SILKW-SPTGDYFF-AAKFDGTFYLWETNTWTSEPWSS 293 (350)
Q Consensus 231 ~~d~g------~i~i-wd~~~~~~~~--~~~~~~----~v--~~~~~-sp~g~~l~-~~~~d~~v~iwd~~~~~~~~~~~ 293 (350)
...+- .|-. -|...|.... ...+.+ .+ ....+ .++.++|+ ++...+.+.+||..+.+..+...
T Consensus 349 yRs~pn~p~~r~il~~~d~~dG~pVc~~r~~~~Gs~~~kl~t~~ai~~~~~nn~iv~~gd~tn~lil~D~~s~evvQ~l~ 428 (463)
T KOG1645|consen 349 YRSNPNFPQSRFILGRIDFRDGFPVCGKRRTYFGSKQTKLSTTQAIRAVEDNNYIVVVGDSTNELILQDPHSFEVVQTLA 428 (463)
T ss_pred ecCCCCCccceeeeeeeccccCceeeeecccccCCcccccccccceeccccccEEEEecCCcceeEEeccchhheeeecc
Confidence 33210 1111 1222222111 001100 00 01112 34455554 45556799999999999877666
Q ss_pred CCCCeEEEEEcC-C-CCEEEEEECCCeEEEEE
Q 018806 294 TSGFVTGATWDP-E-GRMILLAFAGSLTLGSI 323 (350)
Q Consensus 294 ~~~~v~~~~~s~-~-g~~l~~~~~~~~~~~~~ 323 (350)
...+|.++.... + +.+|++=.++...++.+
T Consensus 429 ~~epv~Dicp~~~n~~syLa~LTd~~v~Iyk~ 460 (463)
T KOG1645|consen 429 LSEPVLDICPNDTNGSSYLALLTDDRVHIYKN 460 (463)
T ss_pred cCcceeecceeecCCcchhhheecceEEEEec
Confidence 678888776543 2 34565555555555544
No 299
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=98.45 E-value=3.7e-06 Score=67.10 Aligned_cols=72 Identities=18% Similarity=0.382 Sum_probs=59.4
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--eeeecCCCeEEEEEcC-CCCEEEEEecCCeEEEEeCCC
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--PIRRGFGGLSILKWSP-TGDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~~~~~~~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~~~ 285 (350)
.|.+++-+|..+++++++.++|.+.+||.+..... .+..|+.++..+-|+| ++..|+++++||.+.-||..+
T Consensus 181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~l~ahk~~i~eV~FHpk~p~~Lft~sedGslw~wdas~ 255 (319)
T KOG4714|consen 181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSLLKAHKAEIWEVHFHPKNPEHLFTCSEDGSLWHWDAST 255 (319)
T ss_pred cchhhhCCcccccEEEEecCCCeEEEEEcccccchHHHHHHhhhhhhheeccCCCchheeEecCCCcEEEEcCCC
Confidence 58889999987777666655589999999987432 2456889999999999 578899999999999999875
No 300
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.44 E-value=1e-06 Score=50.12 Aligned_cols=34 Identities=26% Similarity=0.725 Sum_probs=31.5
Q ss_pred eeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEe
Q 018806 249 PIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWE 282 (350)
Q Consensus 249 ~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd 282 (350)
.+..|...|.+++|+|++++|++++.|+.|++||
T Consensus 6 ~~~~h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 6 TFRGHSSSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EEESSSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred EEcCCCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence 4567889999999999999999999999999997
No 301
>PRK02888 nitrous-oxide reductase; Validated
Probab=98.40 E-value=2.5e-05 Score=71.32 Aligned_cols=102 Identities=15% Similarity=0.174 Sum_probs=69.0
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce---------eee---ecCCCeEEEEEcCCCCEEEEEecCCeEEE
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT---------PIR---RGFGGLSILKWSPTGDYFFAAKFDGTFYL 280 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~---------~~~---~~~~~v~~~~~sp~g~~l~~~~~d~~v~i 280 (350)
.....+.++|||+++++++.-+.++.+.|+.+.+.. .+. .-.......+|.++|....+..-|..|..
T Consensus 321 KsPHGV~vSPDGkylyVanklS~tVSVIDv~k~k~~~~~~~~~~~~vvaevevGlGPLHTaFDg~G~aytslf~dsqv~k 400 (635)
T PRK02888 321 KNPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLDDLFDGKIKPRDAVVAEPELGLGPLHTAFDGRGNAYTTLFLDSQIVK 400 (635)
T ss_pred CCccceEECCCCCEEEEeCCCCCcEEEEEChhhhhhhhccCCccceEEEeeccCCCcceEEECCCCCEEEeEeecceeEE
Confidence 467889999999999988876579999999875421 011 11234567899999987777788999999
Q ss_pred EeCCC----------Cceec-cc-----cCCCCeEEEEEcCCCCEEEEEE
Q 018806 281 WETNT----------WTSEP-WS-----STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 281 wd~~~----------~~~~~-~~-----~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
||+.. ..... +. +|......=.-.|||++|++.+
T Consensus 401 wn~~~a~~~~~g~~~~~v~~k~dV~y~pgh~~~~~g~t~~~dgk~l~~~n 450 (635)
T PRK02888 401 WNIEAAIRAYKGEKVDPIVQKLDVHYQPGHNHASMGETKEADGKWLVSLN 450 (635)
T ss_pred EehHHHHHHhccccCCcceecccCCCccceeeecCCCcCCCCCCEEEEcc
Confidence 99876 12211 21 2221111223478999998764
No 302
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=98.37 E-value=0.00022 Score=62.86 Aligned_cols=100 Identities=17% Similarity=0.314 Sum_probs=65.1
Q ss_pred eEEEC-CCCCeEEEEEeCCC--eEEEEeCCCCCceeeeecCCCeE-EEEEcCCCCEEE-EEec----CCeEEEEeCC-CC
Q 018806 217 ALSWG-PDGRYLASASYESS--SFTIWDVAQGLGTPIRRGFGGLS-ILKWSPTGDYFF-AAKF----DGTFYLWETN-TW 286 (350)
Q Consensus 217 ~~~~s-p~g~~l~~~~~d~g--~i~iwd~~~~~~~~~~~~~~~v~-~~~~sp~g~~l~-~~~~----d~~v~iwd~~-~~ 286 (350)
.+.|. +++..++..+..+| .|.+++...+....+..+.-.|. -+.|+++++.|. ++.. ...|+.-+++ .+
T Consensus 239 ~~~~~~~~~~~~l~~s~~~G~~hly~~~~~~~~~~~lT~G~~~V~~i~~~d~~~~~iyf~a~~~~p~~r~lY~v~~~~~~ 318 (353)
T PF00930_consen 239 PPHFLGPDGNEFLWISERDGYRHLYLYDLDGGKPRQLTSGDWEVTSILGWDEDNNRIYFTANGDNPGERHLYRVSLDSGG 318 (353)
T ss_dssp EEEE-TTTSSEEEEEEETTSSEEEEEEETTSSEEEESS-SSS-EEEEEEEECTSSEEEEEESSGGTTSBEEEEEETTETT
T ss_pred ccccccCCCCEEEEEEEcCCCcEEEEEcccccceeccccCceeecccceEcCCCCEEEEEecCCCCCceEEEEEEeCCCC
Confidence 45554 77766665554445 67777877776666666666675 477899888774 4443 2367777888 66
Q ss_pred ceeccccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 287 TSEPWSSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 287 ~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
+...+.........+.|||+|++++..+.+
T Consensus 319 ~~~~LT~~~~~~~~~~~Spdg~y~v~~~s~ 348 (353)
T PF00930_consen 319 EPKCLTCEDGDHYSASFSPDGKYYVDTYSG 348 (353)
T ss_dssp EEEESSTTSSTTEEEEE-TTSSEEEEEEES
T ss_pred CeEeccCCCCCceEEEECCCCCEEEEEEcC
Confidence 666666544444699999999999887643
No 303
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.37 E-value=0.0001 Score=68.53 Aligned_cols=198 Identities=10% Similarity=0.029 Sum_probs=120.2
Q ss_pred EEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCC-CeEEEEecC-C----cEEEEecCCCCCC
Q 018806 106 SWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNG-GRSLSVGCK-G----GICIWAPSYPGNA 179 (350)
Q Consensus 106 ~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~-~~l~~~~~d-~----~v~iwd~~~~~~~ 179 (350)
.|++.+..+|.|+.+|.|.+++-. .+....+ ..+...+...-|.-++ ..|++.+.| . .++||+++.....
T Consensus 30 c~~s~~~~vvigt~~G~V~~Ln~s---~~~~~~f-qa~~~siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~lek~~~n 105 (933)
T KOG2114|consen 30 CCSSSTGSVVIGTADGRVVILNSS---FQLIRGF-QAYEQSIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDLEKVDKN 105 (933)
T ss_pred EEcCCCceEEEeeccccEEEeccc---ceeeehh-eecchhhhhHhhcccCceEEEEEeecCCCCceEEEEecccccCCC
Confidence 467889999999999998777642 2221222 3444453333344443 466667766 3 5899999843211
Q ss_pred c-eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC----CCce-eeeec
Q 018806 180 A-SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ----GLGT-PIRRG 253 (350)
Q Consensus 180 ~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~----~~~~-~~~~~ 253 (350)
. +.... ..++.....+....++.+++.+.+-+.+++|-.+ |.|..+.-+- +... .....
T Consensus 106 ~sP~c~~--------------~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~n-G~V~~~~GDi~RDrgsr~~~~~~~ 170 (933)
T KOG2114|consen 106 NSPQCLY--------------EHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTN-GLVICYKGDILRDRGSRQDYSHRG 170 (933)
T ss_pred CCcceee--------------eeeeeccCCCCCCCcceEEEEEccccEEEEEecC-cEEEEEcCcchhccccceeeeccC
Confidence 1 00000 0000110111124678899999998888888888 8999885321 1111 12234
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEE
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGS 322 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~ 322 (350)
..+|+.+++..+++.++....-..|.+|.+..... ..+..++..+.+.+|++-...++++.+.-...|.
T Consensus 171 ~~pITgL~~~~d~~s~lFv~Tt~~V~~y~l~gr~p~~~~ld~~G~~lnCss~~~~t~qfIca~~e~l~fY~ 241 (933)
T KOG2114|consen 171 KEPITGLALRSDGKSVLFVATTEQVMLYSLSGRTPSLKVLDNNGISLNCSSFSDGTYQFICAGSEFLYFYD 241 (933)
T ss_pred CCCceeeEEecCCceeEEEEecceeEEEEecCCCcceeeeccCCccceeeecCCCCccEEEecCceEEEEc
Confidence 67899999999998854445556799999985552 3355677788888888866646656544334333
No 304
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=98.37 E-value=0.00031 Score=58.84 Aligned_cols=192 Identities=11% Similarity=0.037 Sum_probs=111.6
Q ss_pred EEEecCCCEEEEEE-----CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-------CcEEEEe
Q 018806 105 VSWHQHKHIVAFIS-----GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-------GGICIWA 172 (350)
Q Consensus 105 v~~sp~g~~la~~s-----~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-------~~v~iwd 172 (350)
-.||+||++|++.- ..|.|-|||.. .....+..+ ..|.-.-..+.+.|||+.|+++-.. |..++ |
T Consensus 56 g~fs~dG~~LytTEnd~~~g~G~IgVyd~~-~~~~ri~E~-~s~GIGPHel~l~pDG~tLvVANGGI~Thpd~GR~kL-N 132 (305)
T PF07433_consen 56 GVFSPDGRLLYTTENDYETGRGVIGVYDAA-RGYRRIGEF-PSHGIGPHELLLMPDGETLVVANGGIETHPDSGRAKL-N 132 (305)
T ss_pred EEEcCCCCEEEEeccccCCCcEEEEEEECc-CCcEEEeEe-cCCCcChhhEEEcCCCCEEEEEcCCCccCcccCceec-C
Confidence 46899999999853 36899999996 234444444 3455566788999998777664321 22222 2
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeec-cCCCCCceeeEEECCCCCeEEEEEeCCC-------eEEEEeCCC
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFL-RSQNGEQITALSWGPDGRYLASASYESS-------SFTIWDVAQ 244 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~g-------~i~iwd~~~ 244 (350)
++....... +-...++.+.-...+ ..++..++..+++.++|..++..-.. | -+.+++...
T Consensus 133 l~tM~psL~-----------~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~q-g~~~~~~PLva~~~~g~ 200 (305)
T PF07433_consen 133 LDTMQPSLV-----------YLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFAMQYQ-GDPGDAPPLVALHRRGG 200 (305)
T ss_pred hhhcCCceE-----------EEecCCCceeeeeecCccccccceeeEEecCCCcEEEEEecC-CCCCccCCeEEEEcCCC
Confidence 221111100 000111221112223 12233689999999998766654333 2 234444332
Q ss_pred CCceee-------eecCCCeEEEEEcCCCCEEEEEe-cCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 245 GLGTPI-------RRGFGGLSILKWSPTGDYFFAAK-FDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 245 ~~~~~~-------~~~~~~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
. ...+ ..-.+.+-+++++++|.++++.+ ..+.+.+||..+++......-. -+..++-.+++ ++++++
T Consensus 201 ~-~~~~~~p~~~~~~l~~Y~gSIa~~~~g~~ia~tsPrGg~~~~~d~~tg~~~~~~~l~-D~cGva~~~~~-f~~ssG 275 (305)
T PF07433_consen 201 A-LRLLPAPEEQWRRLNGYIGSIAADRDGRLIAVTSPRGGRVAVWDAATGRLLGSVPLP-DACGVAPTDDG-FLVSSG 275 (305)
T ss_pred c-ceeccCChHHHHhhCCceEEEEEeCCCCEEEEECCCCCEEEEEECCCCCEeeccccC-ceeeeeecCCc-eEEeCC
Confidence 1 1111 12247899999999999886554 5679999999999986544332 35667766766 555443
No 305
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=98.37 E-value=5.5e-07 Score=83.21 Aligned_cols=183 Identities=13% Similarity=0.212 Sum_probs=127.1
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC--CcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK--GGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d--~~v~iwd~~~~~~ 178 (350)
..+|++|+-+.++|+.|+-.|.|+++++.. |...... .+|+..|+.+.-+-+|..+++.+.- --..+|++.....
T Consensus 1103 ~fTc~afs~~~~hL~vG~~~Geik~~nv~s--G~~e~s~-ncH~SavT~vePs~dgs~~Ltsss~S~PlsaLW~~~s~~~ 1179 (1516)
T KOG1832|consen 1103 LFTCIAFSGGTNHLAVGSHAGEIKIFNVSS--GSMEESV-NCHQSAVTLVEPSVDGSTQLTSSSSSSPLSALWDASSTGG 1179 (1516)
T ss_pred ceeeEEeecCCceEEeeeccceEEEEEccC--ccccccc-cccccccccccccCCcceeeeeccccCchHHHhccccccC
Confidence 479999999999999999999999999965 5544444 5899999999999999888887764 3567999873221
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee-ee----c
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI-RR----G 253 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~-~~----~ 253 (350)
. .|.-..-.++.|+..-+.-+.++..+ ...+||+.++..... .. .
T Consensus 1180 ~-----------------------------~Hsf~ed~~vkFsn~~q~r~~gt~~d-~a~~YDvqT~~~l~tylt~~~~~ 1229 (1516)
T KOG1832|consen 1180 P-----------------------------RHSFDEDKAVKFSNSLQFRALGTEAD-DALLYDVQTCSPLQTYLTDTVTS 1229 (1516)
T ss_pred c-----------------------------cccccccceeehhhhHHHHHhccccc-ceEEEecccCcHHHHhcCcchhh
Confidence 1 12223446778877655545555553 799999999865432 22 2
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
...-....|+|+..+++- || -+||++..+... +-..... ..-.|+|+|..++.- ..+|+++.+
T Consensus 1230 ~y~~n~a~FsP~D~LIln---dG--vLWDvR~~~aIh~FD~ft~~-~~G~FHP~g~eVIIN----SEIwD~RTF 1293 (1516)
T KOG1832|consen 1230 SYSNNLAHFSPCDTLILN---DG--VLWDVRIPEAIHRFDQFTDY-GGGGFHPSGNEVIIN----SEIWDMRTF 1293 (1516)
T ss_pred hhhccccccCCCcceEee---Cc--eeeeeccHHHHhhhhhheec-ccccccCCCceEEee----chhhhhHHH
Confidence 233467889999987763 45 479998775532 2222222 234689999998877 567776654
No 306
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.36 E-value=2.3e-06 Score=70.96 Aligned_cols=175 Identities=13% Similarity=0.146 Sum_probs=111.3
Q ss_pred CeeEEEEecC--CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQH--KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~--g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+.++|+-+ |-. ++.+.+-.+-+-++++ +.. .. ....+.|.++.|.-.+..++.+...|.|..+|++....
T Consensus 213 ~a~~CawSlni~gyh-fs~G~sqqv~L~nvet--g~~--qs-f~sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnq 286 (425)
T KOG2695|consen 213 KAWSCAWSLNIMGYH-FSVGLSQQVLLTNVET--GHQ--QS-FQSKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQ 286 (425)
T ss_pred cchhhhhhhccceee-ecccccceeEEEEeec--ccc--cc-cccchhHHHHHhcccCCeeEecccCCcEEEEEeeeccc
Confidence 3445577643 233 4445666677888864 321 11 13567799999998767777777789999999985421
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeCCCCCce-eeeecCCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDVAQGLGT-PIRRGFGG 256 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~~~~~-~~~~~~~~ 256 (350)
- . .|.... + .+++.|+++..-. ++++|++.+.+ |+|++||.+--++. .+....+.
T Consensus 287 G-~------------------~~~a~r-l--yh~Ssvtslq~Lq~s~q~LmaS~M~-gkikLyD~R~~K~~~~V~qYeGH 343 (425)
T KOG2695|consen 287 G-N------------------GWCAQR-L--YHDSSVTSLQILQFSQQKLMASDMT-GKIKLYDLRATKCKKSVMQYEGH 343 (425)
T ss_pred C-C------------------CcceEE-E--EcCcchhhhhhhccccceEeeccCc-CceeEeeehhhhcccceeeeecc
Confidence 1 1 111111 1 1246888887765 78899999999 79999999876552 12222222
Q ss_pred eEE-----EEEcCCCCEEEEEecCCeEEEEeCCCCceeccccC-----CCCeEEEEEc
Q 018806 257 LSI-----LKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSST-----SGFVTGATWD 304 (350)
Q Consensus 257 v~~-----~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~-----~~~v~~~~~s 304 (350)
|.. +-..+....++++++|...+||.++.+........ +..+.+++|.
T Consensus 344 vN~~a~l~~~v~~eeg~I~s~GdDcytRiWsl~~ghLl~tipf~~s~~e~d~~sv~~~ 401 (425)
T KOG2695|consen 344 VNLSAYLPAHVKEEEGSIFSVGDDCYTRIWSLDSGHLLCTIPFPYSASEVDIPSVAFD 401 (425)
T ss_pred cccccccccccccccceEEEccCeeEEEEEecccCceeeccCCCCccccccccceehh
Confidence 322 33456667888899999999999999987443322 2234555654
No 307
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=98.34 E-value=2.5e-06 Score=70.71 Aligned_cols=132 Identities=13% Similarity=0.068 Sum_probs=94.4
Q ss_pred CCCccCeeEEEEecCCCEEEEEECCCeEEEEEccCC---CCCceeEecCCCCCCeeEEEEee-CCCeEEEEecCCcEEEE
Q 018806 96 LLPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS---EGKDACILTSDSQRDVKVLEWRP-NGGRSLSVGCKGGICIW 171 (350)
Q Consensus 96 ~~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~---~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iw 171 (350)
+....+|.++.|...++++..|...|.|...|+... ++.+...+ -|+..|+++..-. +++.|++++.+|+|++|
T Consensus 249 f~sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rl--yh~Ssvtslq~Lq~s~q~LmaS~M~gkikLy 326 (425)
T KOG2695|consen 249 FQSKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRL--YHDSSVTSLQILQFSQQKLMASDMTGKIKLY 326 (425)
T ss_pred cccchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEE--EcCcchhhhhhhccccceEeeccCcCceeEe
Confidence 344558999999999999999999999999999643 23333444 4888999988765 56788888889999999
Q ss_pred ecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCC-ceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee
Q 018806 172 APSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGE-QITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI 250 (350)
Q Consensus 172 d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~ 250 (350)
|++..+.... +..+.||.+. ...-+...+....+++++.| -..+||.++.+.....
T Consensus 327 D~R~~K~~~~----------------------V~qYeGHvN~~a~l~~~v~~eeg~I~s~GdD-cytRiWsl~~ghLl~t 383 (425)
T KOG2695|consen 327 DLRATKCKKS----------------------VMQYEGHVNLSAYLPAHVKEEEGSIFSVGDD-CYTRIWSLDSGHLLCT 383 (425)
T ss_pred eehhhhcccc----------------------eeeeecccccccccccccccccceEEEccCe-eEEEEEecccCceeec
Confidence 9984443222 3345666421 11223445666788888888 5999999999977654
Q ss_pred ee
Q 018806 251 RR 252 (350)
Q Consensus 251 ~~ 252 (350)
..
T Consensus 384 ip 385 (425)
T KOG2695|consen 384 IP 385 (425)
T ss_pred cC
Confidence 43
No 308
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=98.33 E-value=0.00063 Score=56.08 Aligned_cols=191 Identities=13% Similarity=0.186 Sum_probs=99.6
Q ss_pred CeeEEEEecCCCEEEE-EECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCC
Q 018806 101 DLQGVSWHQHKHIVAF-ISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGN 178 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~-~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~ 178 (350)
++.+++|+|+.+.|++ ....+.|..++. +++.+..+.....+-.-.+++..++ .++.+.. ++.+.++++.....
T Consensus 23 e~SGLTy~pd~~tLfaV~d~~~~i~els~---~G~vlr~i~l~g~~D~EgI~y~g~~-~~vl~~Er~~~L~~~~~~~~~~ 98 (248)
T PF06977_consen 23 ELSGLTYNPDTGTLFAVQDEPGEIYELSL---DGKVLRRIPLDGFGDYEGITYLGNG-RYVLSEERDQRLYIFTIDDDTT 98 (248)
T ss_dssp -EEEEEEETTTTEEEEEETTTTEEEEEET---T--EEEEEE-SS-SSEEEEEE-STT-EEEEEETTTTEEEEEEE----T
T ss_pred CccccEEcCCCCeEEEEECCCCEEEEEcC---CCCEEEEEeCCCCCCceeEEEECCC-EEEEEEcCCCcEEEEEEecccc
Confidence 4999999998765555 445666655554 3565555543334568889998764 4544443 68899988853322
Q ss_pred CceeecccccccceecCCCCCceEEee-eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC---CCceeee---
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVD-FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ---GLGTPIR--- 251 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~---~~~~~~~--- 251 (350)
....... .... .+....+..+-.++|+|.++.|+.+-..+ -..+|.++. .......
T Consensus 99 ~~~~~~~----------------~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~-P~~l~~~~~~~~~~~~~~~~~~ 161 (248)
T PF06977_consen 99 SLDRADV----------------QKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERK-PKRLYEVNGFPGGFDLFVSDDQ 161 (248)
T ss_dssp T--EEEE----------------EEEE---S---SS--EEEEEETTTTEEEEEEESS-SEEEEEEESTT-SS--EEEE-H
T ss_pred ccchhhc----------------eEEecccccCCCcceEEEEEcCCCCEEEEEeCCC-ChhhEEEccccCccceeecccc
Confidence 1111100 0000 01111235789999999888888776664 666666654 1111111
Q ss_pred ------ecCCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCceec---ccc-------CCCCeEEEEEcCCCCEEEEE
Q 018806 252 ------RGFGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTSEP---WSS-------TSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 252 ------~~~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~~~---~~~-------~~~~v~~~~~s~~g~~l~~~ 313 (350)
.....+.++.++|. |++++....++.|..+| ..|+... +.. .-...-.|+|.++|++.+++
T Consensus 162 ~~~~~~~~~~d~S~l~~~p~t~~lliLS~es~~l~~~d-~~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYIvs 239 (248)
T PF06977_consen 162 DLDDDKLFVRDLSGLSYDPRTGHLLILSDESRLLLELD-RQGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYIVS 239 (248)
T ss_dssp HHH-HT--SS---EEEEETTTTEEEEEETTTTEEEEE--TT--EEEEEE-STTGGG-SS---SEEEEEE-TT--EEEEE
T ss_pred ccccccceeccccceEEcCCCCeEEEEECCCCeEEEEC-CCCCEEEEEEeCCcccCcccccCCccEEEECCCCCEEEEc
Confidence 12245788999996 55667777788999999 4555532 221 11346789999999777655
No 309
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=98.30 E-value=6.6e-06 Score=67.38 Aligned_cols=171 Identities=15% Similarity=0.212 Sum_probs=108.5
Q ss_pred CCccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCC-----CCeeEEEEeeCCCe-EEEEecCCcEEE
Q 018806 97 LPEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQ-----RDVKVLEWRPNGGR-SLSVGCKGGICI 170 (350)
Q Consensus 97 ~~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~-----~~v~~~~~sp~~~~-l~~~~~d~~v~i 170 (350)
.+...+.+++|+.|...+++ +.|-.|.+|+++..++.....-..+|. .-|++..|+|.... +.++++.|.|++
T Consensus 170 aH~yhiNSiS~NsD~et~lS-aDdLrINLWnl~i~D~sFnIVDiKP~nmeeLteVItSaeFhp~~cn~fmYSsSkG~Ikl 248 (460)
T COG5170 170 AHPYHINSISFNSDKETLLS-ADDLRINLWNLEIIDGSFNIVDIKPHNMEELTEVITSAEFHPEMCNVFMYSSSKGEIKL 248 (460)
T ss_pred cceeEeeeeeecCchheeee-ccceeeeeccccccCCceEEEeccCccHHHHHHHHhhcccCHhHcceEEEecCCCcEEe
Confidence 34557899999999988887 467789999998665544333333443 35889999997544 445566799999
Q ss_pred EecCCCCCC---ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc
Q 018806 171 WAPSYPGNA---ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG 247 (350)
Q Consensus 171 wd~~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~ 247 (350)
-|++..... ..+...... +. -..-+.+-. ..|..+.|+++|++|++-... ++++||++..+.
T Consensus 249 ~DlRq~alcdn~~klfe~~~D--------~v----~~~ff~eiv-sSISD~kFs~ngryIlsRdyl--tvkiwDvnm~k~ 313 (460)
T COG5170 249 NDLRQSALCDNSKKLFELTID--------GV----DVDFFEEIV-SSISDFKFSDNGRYILSRDYL--TVKIWDVNMAKN 313 (460)
T ss_pred hhhhhhhhccCchhhhhhccC--------cc----cchhHHHHh-hhhcceEEcCCCcEEEEeccc--eEEEEecccccC
Confidence 999832111 111000000 00 001122222 578899999999999987665 899999986532
Q ss_pred -eeee-ec------------CCCe---EEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 248 -TPIR-RG------------FGGL---SILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 248 -~~~~-~~------------~~~v---~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
.... -| ...| ..+.||-|.+.+++|+..+..-+|-.
T Consensus 314 pikTi~~h~~l~~~l~d~YEnDaifdkFeisfSgd~~~v~sgsy~NNfgiyp~ 366 (460)
T COG5170 314 PIKTIPMHCDLMDELNDVYENDAIFDKFEISFSGDDKHVLSGSYSNNFGIYPT 366 (460)
T ss_pred CceeechHHHHHHHHHhhhhccceeeeEEEEecCCcccccccccccceeeecc
Confidence 2211 11 1233 35788988888988887776666653
No 310
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.29 E-value=0.0013 Score=59.11 Aligned_cols=124 Identities=12% Similarity=0.202 Sum_probs=82.7
Q ss_pred ceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeC---CC----eEEEEeCCCCCcee----eeecCCCeEEEEEcCCCC
Q 018806 200 RWTLVDFLRSQNGEQITALSWGP-DGRYLASASYE---SS----SFTIWDVAQGLGTP----IRRGFGGLSILKWSPTGD 267 (350)
Q Consensus 200 ~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d---~g----~i~iwd~~~~~~~~----~~~~~~~v~~~~~sp~g~ 267 (350)
+..+...++.. ....++.||- +...+.+.... +| .-.+|++...+... .......+.+++++|+..
T Consensus 195 klEvL~yirTE--~dPl~~~Fs~~~~~qi~tVE~s~s~~g~~~~d~ciYE~~r~klqrvsvtsipL~s~v~~ca~sp~E~ 272 (545)
T PF11768_consen 195 KLEVLSYIRTE--NDPLDVEFSLNQPYQIHTVEQSISVKGEPSADSCIYECSRNKLQRVSVTSIPLPSQVICCARSPSED 272 (545)
T ss_pred cEEEEEEEEec--CCcEEEEccCCCCcEEEEEEEecCCCCCceeEEEEEEeecCceeEEEEEEEecCCcceEEecCcccc
Confidence 44444444443 3457777876 34445443221 12 34567776554332 224568899999999999
Q ss_pred EEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC-CCeEEEEEEeC
Q 018806 268 YFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA-GSLTLGSIHFA 326 (350)
Q Consensus 268 ~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~-~~~~~~~~~~~ 326 (350)
.++.|+.||+|.+||...+... +....-.++.++|+|+|..+++|++ +...++++-+.
T Consensus 273 kLvlGC~DgSiiLyD~~~~~t~-~~ka~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALs 331 (545)
T PF11768_consen 273 KLVLGCEDGSIILYDTTRGVTL-LAKAEFIPTLIAWHPDGAIFVVGSEQGELQCFDMALS 331 (545)
T ss_pred eEEEEecCCeEEEEEcCCCeee-eeeecccceEEEEcCCCcEEEEEcCCceEEEEEeecC
Confidence 9999999999999999876443 3344456789999999999999874 44555555444
No 311
>PRK13616 lipoprotein LpqB; Provisional
Probab=98.28 E-value=7.3e-05 Score=69.66 Aligned_cols=156 Identities=15% Similarity=0.147 Sum_probs=98.8
Q ss_pred CCeeEEEEeeCCCeEEEEec------CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeE
Q 018806 145 RDVKVLEWRPNGGRSLSVGC------KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITAL 218 (350)
Q Consensus 145 ~~v~~~~~sp~~~~l~~~~~------d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 218 (350)
..+.+.+.+|+|+.+++... |..-.||-...++....+..+ ...+..
T Consensus 350 ~~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~gg~~~~lt~g---------------------------~~~t~P 402 (591)
T PRK13616 350 GNITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLGGVAVQVLEG---------------------------HSLTRP 402 (591)
T ss_pred cCcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCCCcceeeecC---------------------------CCCCCc
Confidence 46789999999999888762 444455544433322222111 247788
Q ss_pred EECCCCCeEEEEEeCC-----------CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEE---EeCC
Q 018806 219 SWGPDGRYLASASYES-----------SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYL---WETN 284 (350)
Q Consensus 219 ~~sp~g~~l~~~~~d~-----------g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~i---wd~~ 284 (350)
.|+|||+.|++....+ +.+.+.+++.+.... ...+.|..+.|||||..|+... ++.|++ -...
T Consensus 403 sWspDG~~lw~v~dg~~~~~v~~~~~~gql~~~~vd~ge~~~--~~~g~Issl~wSpDG~RiA~i~-~g~v~Va~Vvr~~ 479 (591)
T PRK13616 403 SWSLDADAVWVVVDGNTVVRVIRDPATGQLARTPVDASAVAS--RVPGPISELQLSRDGVRAAMII-GGKVYLAVVEQTE 479 (591)
T ss_pred eECCCCCceEEEecCcceEEEeccCCCceEEEEeccCchhhh--ccCCCcCeEEECCCCCEEEEEE-CCEEEEEEEEeCC
Confidence 9999998877765321 234444554443332 3356799999999999998766 477777 4444
Q ss_pred CCcee-----cccc-CCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC
Q 018806 285 TWTSE-----PWSS-TSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP 330 (350)
Q Consensus 285 ~~~~~-----~~~~-~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~ 330 (350)
.|+.. .+.. ....+.+++|..++.+++...+.+..++.+.+.....
T Consensus 480 ~G~~~l~~~~~l~~~l~~~~~~l~W~~~~~L~V~~~~~~~~v~~v~vDG~~~ 531 (591)
T PRK13616 480 DGQYALTNPREVGPGLGDTAVSLDWRTGDSLVVGRSDPEHPVWYVNLDGSNS 531 (591)
T ss_pred CCceeecccEEeecccCCccccceEecCCEEEEEecCCCCceEEEecCCccc
Confidence 55421 1222 3334688999999997654445556788888876544
No 312
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=98.25 E-value=6.5e-06 Score=81.76 Aligned_cols=154 Identities=14% Similarity=0.193 Sum_probs=114.2
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG 221 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s 221 (350)
.+-..|.++.=+|....+++++.||.+++|....+.....+... + ...|+.+.|+
T Consensus 2206 ~~v~~v~r~~sHp~~~~Yltgs~dgsv~~~~w~~~~~v~~~rt~-----------------------g--~s~vtr~~f~ 2260 (2439)
T KOG1064|consen 2206 HPVENVRRMTSHPSDPYYLTGSQDGSVRMFEWGHGQQVVCFRTA-----------------------G--NSRVTRSRFN 2260 (2439)
T ss_pred cccCceeeecCCCCCceEEecCCCceEEEEeccCCCeEEEeecc-----------------------C--cchhhhhhhc
Confidence 35567888888898888999999999999998755443332222 1 2689999999
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe---cCCeEEEEeCCCCce--eccccCCC
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK---FDGTFYLWETNTWTS--EPWSSTSG 296 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~---~d~~v~iwd~~~~~~--~~~~~~~~ 296 (350)
.+|..+..+..| |.+.+|.+........+.|......++|-. ..+++++ .++.+.+||.--... ..-..|.+
T Consensus 2261 ~qGnk~~i~d~d-g~l~l~q~~pk~~~s~qchnk~~~Df~Fi~--s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H~~ 2337 (2439)
T KOG1064|consen 2261 HQGNKFGIVDGD-GDLSLWQASPKPYTSWQCHNKALSDFRFIG--SLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCHDG 2337 (2439)
T ss_pred ccCCceeeeccC-CceeecccCCcceeccccCCccccceeeee--hhhhccccCCCCCcccchhcccCcccceeeeecCC
Confidence 999999999999 799999998444444556778888888865 4566553 467999999753332 22368999
Q ss_pred CeEEEEEcCCCCEEEEEE-CCCeEEEEE
Q 018806 297 FVTGATWDPEGRMILLAF-AGSLTLGSI 323 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~-~~~~~~~~~ 323 (350)
.++.+++.|.-+.|++|+ .+.+.+|++
T Consensus 2338 gaT~l~~~P~~qllisggr~G~v~l~D~ 2365 (2439)
T KOG1064|consen 2338 GATVLAYAPKHQLLISGGRKGEVCLFDI 2365 (2439)
T ss_pred CceEEEEcCcceEEEecCCcCcEEEeeh
Confidence 999999999999888776 444444444
No 313
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.25 E-value=9.4e-07 Score=78.91 Aligned_cols=202 Identities=16% Similarity=0.214 Sum_probs=127.2
Q ss_pred CeeEEEEecCC--CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-----CcEEEEec
Q 018806 101 DLQGVSWHQHK--HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-----GGICIWAP 173 (350)
Q Consensus 101 ~V~~v~~sp~g--~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-----~~v~iwd~ 173 (350)
.+.|++++-+. ..++.|..+|.|.+-.+..+... -..+..++...+++++|++-+...+++|.| ..+.|||+
T Consensus 58 y~kcva~~y~~d~cIlavG~atG~I~l~s~r~~hdS-s~E~tp~~ar~Ct~lAwneLDtn~LAagldkhrnds~~~Iwdi 136 (783)
T KOG1008|consen 58 YVKCVASFYGNDRCILAVGSATGNISLLSVRHPHDS-SAEVTPGYARPCTSLAWNELDTNHLAAGLDKHRNDSSLKIWDI 136 (783)
T ss_pred CceeehhhcCCchhhhhhccccCceEEeecCCcccc-cceecccccccccccccccccHHHHHhhhhhhcccCCccceec
Confidence 47777776543 58888999999999887532222 244455788999999999876667777654 56899999
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG 253 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~ 253 (350)
... ...++... . +.+.......+++|-.+.+.+.+|.... .+.++|++........-.
T Consensus 137 ~s~-ltvPke~~----------------~----fs~~~l~gqns~cwlrd~klvlaGm~sr-~~~ifdlRqs~~~~~svn 194 (783)
T KOG1008|consen 137 NSL-LTVPKESP----------------L----FSSSTLDGQNSVCWLRDTKLVLAGMTSR-SVHIFDLRQSLDSVSSVN 194 (783)
T ss_pred ccc-cCCCcccc----------------c----cccccccCccccccccCcchhhcccccc-hhhhhhhhhhhhhhhhhh
Confidence 833 11111111 0 0110123455888888888888888874 899999984422222222
Q ss_pred CCCeEEEEEcC-CCCEEEEEecCCeEEEEeC-CCCce-e-ccccCC----CCeEEEEEcCCCCEEEE-EECCCeEEEEEE
Q 018806 254 FGGLSILKWSP-TGDYFFAAKFDGTFYLWET-NTWTS-E-PWSSTS----GFVTGATWDPEGRMILL-AFAGSLTLGSIH 324 (350)
Q Consensus 254 ~~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~-~~~~~-~-~~~~~~----~~v~~~~~s~~g~~l~~-~~~~~~~~~~~~ 324 (350)
...+..+...| .+.++++-. |+.|.+||. +.-+. . .+.... ..+..++|+|-..-+.+ ...++++++..+
T Consensus 195 Tk~vqG~tVdp~~~nY~cs~~-dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~~aycPtrtglla~l~RdS~tIrlyd 273 (783)
T KOG1008|consen 195 TKYVQGITVDPFSPNYFCSNS-DGDIAIWDTYRNIENPLQIILRNENKKPKQLFALAYCPTRTGLLAVLSRDSITIRLYD 273 (783)
T ss_pred hhhcccceecCCCCCceeccc-cCceeeccchhhhccHHHHHhhCCCCcccceeeEEeccCCcchhhhhccCcceEEEec
Confidence 34566677777 667776655 999999994 33222 1 122222 24889999996654443 345556666665
Q ss_pred eC
Q 018806 325 FA 326 (350)
Q Consensus 325 ~~ 326 (350)
+.
T Consensus 274 i~ 275 (783)
T KOG1008|consen 274 IC 275 (783)
T ss_pred cc
Confidence 54
No 314
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=98.21 E-value=0.00037 Score=61.44 Aligned_cols=223 Identities=20% Similarity=0.323 Sum_probs=123.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCC----------------CCCeeEEEEeeCCCeEEEEe
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDS----------------QRDVKVLEWRPNGGRSLSVG 163 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~----------------~~~v~~~~~sp~~~~l~~~~ 163 (350)
..+....|||+|+.||... ++.|.+++... +........+. -+.-..+-||||+++|++..
T Consensus 43 ~~~~~~~~sP~g~~~~~v~-~~nly~~~~~~--~~~~~lT~dg~~~i~nG~~dwvyeEEv~~~~~~~~WSpd~~~la~~~ 119 (353)
T PF00930_consen 43 PKLQDAKWSPDGKYIAFVR-DNNLYLRDLAT--GQETQLTTDGEPGIYNGVPDWVYEEEVFDRRSAVWWSPDSKYLAFLR 119 (353)
T ss_dssp TTBSEEEE-SSSTEEEEEE-TTEEEEESSTT--SEEEESES--TTTEEESB--HHHHHHTSSSSBSEEE-TTSSEEEEEE
T ss_pred cccccceeecCCCeeEEEe-cCceEEEECCC--CCeEEeccccceeEEcCccceeccccccccccceEECCCCCEEEEEE
Confidence 4578899999999999875 57788887743 33222222220 11236788999999999888
Q ss_pred cC-CcEEEEecCC---CCC--Cc--eee---ccccccccee--cCCCCCceEEeee---ccCCCCCceeeEEECCCCCeE
Q 018806 164 CK-GGICIWAPSY---PGN--AA--SVR---SGAASFLGAL--SRGPGTRWTLVDF---LRSQNGEQITALSWGPDGRYL 227 (350)
Q Consensus 164 ~d-~~v~iwd~~~---~~~--~~--~~~---~~~~~~~~~~--~~~~~~~~~~~~~---~~~~~~~~v~~~~~sp~g~~l 227 (350)
.| ..|..+.+.. ... +. .+. .+...+...+ ..-..++...+.. +... +.-+..+.|.++++.|
T Consensus 120 ~d~~~v~~~~~~~~~~~~~~yp~~~~~~YPk~G~~np~v~l~v~~~~~~~~~~~~~~~~~~~~-~~yl~~v~W~~d~~~l 198 (353)
T PF00930_consen 120 FDEREVPEYPLPDYSPPDSQYPEVESIRYPKAGDPNPRVSLFVVDLASGKTTELDPPNSLNPQ-DYYLTRVGWSPDGKRL 198 (353)
T ss_dssp EE-TTS-EEEEEEESSSTESS-EEEEEE--BTTS---EEEEEEEESSSTCCCEE---HHHHTS-SEEEEEEEEEETTEEE
T ss_pred ECCcCCceEEeeccCCccccCCcccccccCCCCCcCCceEEEEEECCCCcEEEeeeccccCCC-ccCcccceecCCCcEE
Confidence 75 5555554431 111 11 111 1111111110 0011111111111 1122 3467899999999855
Q ss_pred EEEEeCC----CeEEEEeCCCCCceeeee--cCCCe---EEEEEc-CCCCEE-EEEecCC--eEEEEeCCCCceeccccC
Q 018806 228 ASASYES----SSFTIWDVAQGLGTPIRR--GFGGL---SILKWS-PTGDYF-FAAKFDG--TFYLWETNTWTSEPWSST 294 (350)
Q Consensus 228 ~~~~~d~----g~i~iwd~~~~~~~~~~~--~~~~v---~~~~~s-p~g~~l-~~~~~d~--~v~iwd~~~~~~~~~~~~ 294 (350)
+..-.+. ..+.++|..++....+.. ..+.+ ....|. +++..+ .....+| .|++++..++....+...
T Consensus 199 ~~~~~nR~q~~~~l~~~d~~tg~~~~~~~e~~~~Wv~~~~~~~~~~~~~~~~l~~s~~~G~~hly~~~~~~~~~~~lT~G 278 (353)
T PF00930_consen 199 WVQWLNRDQNRLDLVLCDASTGETRVVLEETSDGWVDVYDPPHFLGPDGNEFLWISERDGYRHLYLYDLDGGKPRQLTSG 278 (353)
T ss_dssp EEEEEETTSTEEEEEEEEECTTTCEEEEEEESSSSSSSSSEEEE-TTTSSEEEEEEETTSSEEEEEEETTSSEEEESS-S
T ss_pred EEEEcccCCCEEEEEEEECCCCceeEEEEecCCcceeeecccccccCCCCEEEEEEEcCCCcEEEEEcccccceeccccC
Confidence 5443321 257777888776654332 23333 355554 666554 4444666 677778888877777766
Q ss_pred CCCeEE-EEEcCCCCEEEEEECC----CeEEEEEEeC
Q 018806 295 SGFVTG-ATWDPEGRMILLAFAG----SLTLGSIHFA 326 (350)
Q Consensus 295 ~~~v~~-~~~s~~g~~l~~~~~~----~~~~~~~~~~ 326 (350)
.-.|.. +.|+++++.|++.+.. ...++.+.+.
T Consensus 279 ~~~V~~i~~~d~~~~~iyf~a~~~~p~~r~lY~v~~~ 315 (353)
T PF00930_consen 279 DWEVTSILGWDEDNNRIYFTANGDNPGERHLYRVSLD 315 (353)
T ss_dssp SS-EEEEEEEECTSSEEEEEESSGGTTSBEEEEEETT
T ss_pred ceeecccceEcCCCCEEEEEecCCCCCceEEEEEEeC
Confidence 667754 7789999998877644 3688888888
No 315
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=98.20 E-value=0.00064 Score=60.99 Aligned_cols=94 Identities=15% Similarity=0.275 Sum_probs=72.9
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce---
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS--- 288 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~--- 288 (350)
+..+.+.+++|+.+.++.|+.| |.|.+||...+..... ...-.+..++|+|+|..+++|+..|.+.+||+.-...
T Consensus 259 ~s~v~~ca~sp~E~kLvlGC~D-gSiiLyD~~~~~t~~~-ka~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALspi~~q 336 (545)
T PF11768_consen 259 PSQVICCARSPSEDKLVLGCED-GSIILYDTTRGVTLLA-KAEFIPTLIAWHPDGAIFVVGSEQGELQCFDMALSPIKMQ 336 (545)
T ss_pred CCcceEEecCcccceEEEEecC-CeEEEEEcCCCeeeee-eecccceEEEEcCCCcEEEEEcCCceEEEEEeecCcccee
Confidence 4689999999999999999999 7999999987743333 3445577899999999999999999999999864332
Q ss_pred -----------e---ccccCCCCeEEEEEcCCC
Q 018806 289 -----------E---PWSSTSGFVTGATWDPEG 307 (350)
Q Consensus 289 -----------~---~~~~~~~~v~~~~~s~~g 307 (350)
. ....+......+.|++..
T Consensus 337 LlsEd~~P~~~L~Ls~yf~~~~~L~~iqW~~~~ 369 (545)
T PF11768_consen 337 LLSEDATPKSTLQLSKYFRVSSSLVHIQWAPAP 369 (545)
T ss_pred eccccCCCccEEeeehhccCcchhheeEeccCC
Confidence 0 112345566788888544
No 316
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=98.18 E-value=0.0012 Score=58.76 Aligned_cols=194 Identities=15% Similarity=0.136 Sum_probs=128.7
Q ss_pred eeEEEEecCCCEEEEE-ECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec---CCcEEEEecCCCC
Q 018806 102 LQGVSWHQHKHIVAFI-SGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC---KGGICIWAPSYPG 177 (350)
Q Consensus 102 V~~v~~sp~g~~la~~-s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~---d~~v~iwd~~~~~ 177 (350)
-..+++++.+..+... ..++.|.+.|... .........+. ....++++|+++.+.++.. ++++.+.|-....
T Consensus 76 p~~i~v~~~~~~vyv~~~~~~~v~vid~~~--~~~~~~~~vG~--~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~ 151 (381)
T COG3391 76 PAGVAVNPAGNKVYVTTGDSNTVSVIDTAT--NTVLGSIPVGL--GPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNK 151 (381)
T ss_pred ccceeeCCCCCeEEEecCCCCeEEEEcCcc--cceeeEeeecc--CCceEEECCCCCEEEEEecccCCceEEEEeCCCCe
Confidence 4577888888755544 4468899999643 33333332232 6788999999877777666 3666666665333
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee-----eee
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP-----IRR 252 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-----~~~ 252 (350)
....+. .+. .+ ..++++|+|..++.+..+++.|.+.|........ ...
T Consensus 152 ~~~~~~------------------------vG~--~P-~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~~v~~~~~~~~~~ 204 (381)
T COG3391 152 VTATIP------------------------VGN--TP-TGVAVDPDGNKVYVTNSDDNTVSVIDTSGNSVVRGSVGSLVG 204 (381)
T ss_pred EEEEEe------------------------cCC--Cc-ceEEECCCCCeEEEEecCCCeEEEEeCCCcceeccccccccc
Confidence 322211 111 23 8899999999888777555799999977665442 122
Q ss_pred cCCCeEEEEEcCCCCEEEEEecC---CeEEEEeCCCCceecc--c-cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 253 GFGGLSILKWSPTGDYFFAAKFD---GTFYLWETNTWTSEPW--S-STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 253 ~~~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~~~~~~~~--~-~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
-......+.++|+|+.+.+.... +.+...|..++..... . ... ....+..+|+|+.+.+.......+..++..
T Consensus 205 ~~~~P~~i~v~~~g~~~yV~~~~~~~~~v~~id~~~~~v~~~~~~~~~~-~~~~v~~~p~g~~~yv~~~~~~~V~vid~~ 283 (381)
T COG3391 205 VGTGPAGIAVDPDGNRVYVANDGSGSNNVLKIDTATGNVTATDLPVGSG-APRGVAVDPAGKAAYVANSQGGTVSVIDGA 283 (381)
T ss_pred cCCCCceEEECCCCCEEEEEeccCCCceEEEEeCCCceEEEeccccccC-CCCceeECCCCCEEEEEecCCCeEEEEeCC
Confidence 23445678999999987665443 5899999999887543 2 222 456789999999999886555566666654
Q ss_pred C
Q 018806 327 S 327 (350)
Q Consensus 327 ~ 327 (350)
.
T Consensus 284 ~ 284 (381)
T COG3391 284 T 284 (381)
T ss_pred C
Confidence 3
No 317
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=98.14 E-value=0.00017 Score=64.70 Aligned_cols=161 Identities=14% Similarity=0.124 Sum_probs=88.7
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEE-ecCCCCCC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIW-APSYPGNA 179 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iw-d~~~~~~~ 179 (350)
....++++|+|+.+++ ..+|...|+.... .. ... .+.-..+.|.+. +.+++....++|.|+ ++. ....
T Consensus 34 ~p~~ls~npngr~v~V-~g~geY~iyt~~~--~r--~k~----~G~g~~~vw~~~-n~yAv~~~~~~I~I~kn~~-~~~~ 102 (443)
T PF04053_consen 34 YPQSLSHNPNGRFVLV-CGDGEYEIYTALA--WR--NKA----FGSGLSFVWSSR-NRYAVLESSSTIKIYKNFK-NEVV 102 (443)
T ss_dssp --SEEEE-TTSSEEEE-EETTEEEEEETTT--TE--EEE----EEE-SEEEE-TS-SEEEEE-TTS-EEEEETTE-E-TT
T ss_pred CCeeEEECCCCCEEEE-EcCCEEEEEEccC--Cc--ccc----cCceeEEEEecC-ccEEEEECCCeEEEEEcCc-cccc
Confidence 4688999999999988 5677777877321 11 111 234677899985 677777778889996 443 2111
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEE
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSI 259 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~ 259 (350)
..+.. +..+..+-. |..|...+.+ .|.+||+.+++........ +|..
T Consensus 103 k~i~~---------------------------~~~~~~If~---G~LL~~~~~~--~i~~yDw~~~~~i~~i~v~-~vk~ 149 (443)
T PF04053_consen 103 KSIKL---------------------------PFSVEKIFG---GNLLGVKSSD--FICFYDWETGKLIRRIDVS-AVKY 149 (443)
T ss_dssp --------------------------------SS-EEEEE----SSSEEEEETT--EEEEE-TTT--EEEEESS--E-EE
T ss_pred eEEcC---------------------------CcccceEEc---CcEEEEECCC--CEEEEEhhHcceeeEEecC-CCcE
Confidence 11111 112233322 7777766544 8999999998776655433 3899
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCC------------ceeccccCCCCeEEEEEcCC
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTW------------TSEPWSSTSGFVTGATWDPE 306 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~------------~~~~~~~~~~~v~~~~~s~~ 306 (350)
+.|+++|++++..+.+ .++|++.+.. ....+......|.+.+|..|
T Consensus 150 V~Ws~~g~~val~t~~-~i~il~~~~~~~~~~~~~g~e~~f~~~~E~~~~IkSg~W~~d 207 (443)
T PF04053_consen 150 VIWSDDGELVALVTKD-SIYILKYNLEAVAAIPEEGVEDAFELIHEISERIKSGCWVED 207 (443)
T ss_dssp EEE-TTSSEEEEE-S--SEEEEEE-HHHHHHBTTTB-GGGEEEEEEE-S--SEEEEETT
T ss_pred EEEECCCCEEEEEeCC-eEEEEEecchhcccccccCchhceEEEEEecceeEEEEEEcC
Confidence 9999999999888754 6778766543 12222222567888888876
No 318
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.08 E-value=0.00016 Score=65.89 Aligned_cols=199 Identities=14% Similarity=0.100 Sum_probs=117.7
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCc
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAA 180 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~ 180 (350)
|.=-+++..+++|+.|+.-|.+++|+-.. +........+..+.+..+..+++ ..++++++ .|.|.++-+.......
T Consensus 36 v~lTc~dst~~~l~~GsS~G~lyl~~R~~--~~~~~~~~~~~~~~~~~~~vs~~-e~lvAagt~~g~V~v~ql~~~~p~~ 112 (726)
T KOG3621|consen 36 VKLTCVDATEEYLAMGSSAGSVYLYNRHT--GEMRKLKNEGATGITCVRSVSSV-EYLVAAGTASGRVSVFQLNKELPRD 112 (726)
T ss_pred EEEEEeecCCceEEEecccceEEEEecCc--hhhhcccccCccceEEEEEecch-hHhhhhhcCCceEEeehhhccCCCc
Confidence 44456677889999999999999999753 33323222233455666777887 55655555 5889988887533332
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC-----CceeeeecCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG-----LGTPIRRGFG 255 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~-----~~~~~~~~~~ 255 (350)
.+. .......+...|++++|++++..+++|... |+|..-.+.+. ....+....+
T Consensus 113 ~~~--------------------~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~-Gkv~~~~L~s~~~~~~~~q~il~~ds 171 (726)
T KOG3621|consen 113 LDY--------------------VTPCDKSHKCRVTALEWSKNGMKLYSGDSQ-GKVVLTELDSRQAFLSKSQEILSEDS 171 (726)
T ss_pred cee--------------------eccccccCCceEEEEEecccccEEeecCCC-ceEEEEEechhhhhccccceeeccCc
Confidence 221 111222124799999999999999999887 89998888772 1223444556
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc--cCCC-CeEEEEEcCC----CCEEEEEECCCeEEEEEEeCC
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS--STSG-FVTGATWDPE----GRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~--~~~~-~v~~~~~s~~----g~~l~~~~~~~~~~~~~~~~~ 327 (350)
.|..+... ++..|++.. -+ -.+++++.++..++- .-.+ .-...+|-|. .+-.+++..-..++|..++.+
T Consensus 172 ~IVQlD~~-q~~LLVStl-~r-~~Lc~tE~eti~QIG~k~R~~~~~~GACF~~g~~~~q~~~IycaRPG~RlWead~~G 247 (726)
T KOG3621|consen 172 EIVQLDYL-QSYLLVSTL-TR-CILCQTEAETITQIGKKPRKSLIDFGACFFPGQCKAQKPQIYCARPGLRLWEADFAG 247 (726)
T ss_pred ceEEeecc-cceehHhhh-hh-hheeecchhHHHHhcCCCcCCccccceEEeeccccCCCceEEEecCCCceEEeecce
Confidence 77666654 333333322 22 235566554432211 1111 1123344332 333444555557888888765
No 319
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=98.08 E-value=0.00016 Score=66.53 Aligned_cols=169 Identities=17% Similarity=0.260 Sum_probs=109.6
Q ss_pred CCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP 222 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 222 (350)
|...-.++.|+|.| +++.|+...|.+-|...-+ .++.+.-|. ..|+.+.|.|
T Consensus 14 ~~sN~~A~Dw~~~G--LiAygshslV~VVDs~s~q-------------------------~iqsie~h~-s~V~~VrWap 65 (1062)
T KOG1912|consen 14 SRSNRNAADWSPSG--LIAYGSHSLVSVVDSRSLQ-------------------------LIQSIELHQ-SAVTSVRWAP 65 (1062)
T ss_pred CcccccccccCccc--eEEEecCceEEEEehhhhh-------------------------hhhccccCc-cceeEEEecc
Confidence 34457788999985 6666677778888877332 234455554 7899999977
Q ss_pred CC-----------C-eEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcC---CC-CEEEEEecCCeEEEEeCCC
Q 018806 223 DG-----------R-YLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSP---TG-DYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 223 ~g-----------~-~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp---~g-~~l~~~~~d~~v~iwd~~~ 285 (350)
-. . .|+++... |.|.+||...+.... +..+..++..++|-+ +. ..|++-....++.+||..+
T Consensus 66 ~~~p~~llS~~~~~lliAsaD~~-GrIil~d~~~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdt 144 (1062)
T KOG1912|consen 66 APSPRDLLSPSSSQLLIASADIS-GRIILVDFVLASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDT 144 (1062)
T ss_pred CCCchhccCccccceeEEecccc-CcEEEEEehhhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccC
Confidence 21 1 34444445 899999999876544 555678889999875 34 4566667788999999999
Q ss_pred Cceeccc-cCCCCeEEEEEcC-CCCEEEEEECCCeEEEEEEeC-CCCCCCceeeccccc
Q 018806 286 WTSEPWS-STSGFVTGATWDP-EGRMILLAFAGSLTLGSIHFA-SKPPSLDAHLLPVDL 341 (350)
Q Consensus 286 ~~~~~~~-~~~~~v~~~~~s~-~g~~l~~~~~~~~~~~~~~~~-~~~~~~~~~~~~v~~ 341 (350)
|+..--. .......++.+.| |.+.+.+-+.+. .+...++- ..++...+|..-|..
T Consensus 145 G~k~Wk~~ys~~iLs~f~~DPfd~rh~~~l~s~g-~vl~~~~l~~sep~~pgk~~qI~s 202 (1062)
T KOG1912|consen 145 GEKFWKYDYSHEILSCFRVDPFDSRHFCVLGSKG-FVLSCKDLGLSEPDVPGKEFQITS 202 (1062)
T ss_pred CceeeccccCCcceeeeeeCCCCcceEEEEccCc-eEEEEeccCCCCCCCCceeEEEec
Confidence 9874333 2334456688888 455555544443 45555543 344455555554443
No 320
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.03 E-value=2.2e-05 Score=69.21 Aligned_cols=154 Identities=13% Similarity=0.186 Sum_probs=105.3
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
.+|...|..++--.+.+.+++++.|++|++|.++..+.... .-.+.-+++.|. .+|.++.|
T Consensus 732 ~GH~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~------------------tsaCQfTY~aHk-k~i~~igf 792 (1034)
T KOG4190|consen 732 TGHQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIG------------------TSACQFTYQAHK-KPIHDIGF 792 (1034)
T ss_pred cCcHHHhHHHHhcccccceeeccCCceEEEEEeccccCccc------------------cceeeeEhhhcc-Ccccceee
Confidence 47888888877655657899999999999999984332211 112455677786 79999999
Q ss_pred CCCCCeEEEEEeCCCeEEEEeCCCCCcee-eee--cCCCeEEEEEcC--CCCEEEEE-ecCCeEEEEeCCCCcee-cc--
Q 018806 221 GPDGRYLASASYESSSFTIWDVAQGLGTP-IRR--GFGGLSILKWSP--TGDYFFAA-KFDGTFYLWETNTWTSE-PW-- 291 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~--~~~~v~~~~~sp--~g~~l~~~-~~d~~v~iwd~~~~~~~-~~-- 291 (350)
-.+-++++++ | |-|.+||---+.... +.. ..+.+..+..-+ +...+..+ +...+|+++|.+..+-. .+
T Consensus 793 L~~lr~i~Sc--D-~giHlWDPFigr~Laq~~dapk~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kV 869 (1034)
T KOG4190|consen 793 LADLRSIASC--D-GGIHLWDPFIGRLLAQMEDAPKEGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKV 869 (1034)
T ss_pred eeccceeeec--c-CcceeecccccchhHhhhcCcccCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEe
Confidence 9988888765 6 689999987766543 221 122222222223 44555444 77899999999987652 12
Q ss_pred ---ccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 292 ---SSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 292 ---~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
......+.+++..+.|++++++-++
T Consensus 870 cna~~Pna~~R~iaVa~~GN~lAa~LSn 897 (1034)
T KOG4190|consen 870 CNAPGPNALTRAIAVADKGNKLAAALSN 897 (1034)
T ss_pred ccCCCCchheeEEEeccCcchhhHHhcC
Confidence 2344568899999999999987533
No 321
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=98.02 E-value=0.00079 Score=65.16 Aligned_cols=159 Identities=16% Similarity=0.282 Sum_probs=99.8
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccC--C-------------------CCCceeEecCC----------------
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYED--S-------------------EGKDACILTSD---------------- 142 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~--~-------------------~~~~~~~~~~~---------------- 142 (350)
..|.+++||||+++++..+..+++.+..-+- - =|+....+ .+
T Consensus 110 ~GI~aaswS~Dee~l~liT~~~tll~mT~~f~~i~E~~L~~d~~~~sk~v~VGwGrkeTqf-rgs~gr~~~~~~~~~ek~ 188 (1265)
T KOG1920|consen 110 NGISAASWSPDEELLALITGRQTLLFMTKDFEPIAEKPLDADDERKSKFVNVGWGRKETQF-RGSEGRQAARQKIEKEKA 188 (1265)
T ss_pred CceEEEeecCCCcEEEEEeCCcEEEEEeccccchhccccccccccccccceecccccceee-ecchhhhccccccccccc
Confidence 4799999999999999999988887654310 0 00000011 00
Q ss_pred -----CCCCeeEEEEeeCCCeEEEEe----cC-CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCC
Q 018806 143 -----SQRDVKVLEWRPNGGRSLSVG----CK-GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNG 212 (350)
Q Consensus 143 -----~~~~v~~~~~sp~~~~l~~~~----~d-~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 212 (350)
....=..+.|--||+.+++.. .+ ++++|||-+ +..... .....
T Consensus 189 ~~~~~~~~~~~~IsWRgDg~~fAVs~~~~~~~~RkirV~drE--g~Lns~-------------------------se~~~ 241 (1265)
T KOG1920|consen 189 LEQIEQDDHKTSISWRGDGEYFAVSFVESETGTRKIRVYDRE--GALNST-------------------------SEPVE 241 (1265)
T ss_pred ccchhhccCCceEEEccCCcEEEEEEEeccCCceeEEEeccc--chhhcc-------------------------cCccc
Confidence 011123589998976666532 34 789999977 211111 11112
Q ss_pred CceeeEEECCCCCeEEEEE---eCCCeEEEEeCCCCCcee----eeecCCCeEEEEEcCCCCEEEE---EecCCeEEEEe
Q 018806 213 EQITALSWGPDGRYLASAS---YESSSFTIWDVAQGLGTP----IRRGFGGLSILKWSPTGDYFFA---AKFDGTFYLWE 282 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~---~d~g~i~iwd~~~~~~~~----~~~~~~~v~~~~~sp~g~~l~~---~~~d~~v~iwd 282 (350)
+.-.+++|-|.|..+++.. .+ +.|.+|.-+.-..-. .......+..++|+.++..||+ ......|++|-
T Consensus 242 ~l~~~LsWkPsgs~iA~iq~~~sd-~~IvffErNGL~hg~f~l~~p~de~~ve~L~Wns~sdiLAv~~~~~e~~~v~lwt 320 (1265)
T KOG1920|consen 242 GLQHSLSWKPSGSLIAAIQCKTSD-SDIVFFERNGLRHGEFVLPFPLDEKEVEELAWNSNSDILAVVTSNLENSLVQLWT 320 (1265)
T ss_pred ccccceeecCCCCeEeeeeecCCC-CcEEEEecCCccccccccCCcccccchheeeecCCCCceeeeecccccceEEEEE
Confidence 3456899999999998763 34 379999866433221 1222344899999999999987 44455699998
Q ss_pred CCCCc
Q 018806 283 TNTWT 287 (350)
Q Consensus 283 ~~~~~ 287 (350)
+.+..
T Consensus 321 ~~Nyh 325 (1265)
T KOG1920|consen 321 TGNYH 325 (1265)
T ss_pred ecCeE
Confidence 87654
No 322
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=98.01 E-value=0.0045 Score=55.61 Aligned_cols=192 Identities=13% Similarity=0.079 Sum_probs=103.5
Q ss_pred EEEecCCCEEEEEECC----------C-eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEec
Q 018806 105 VSWHQHKHIVAFISGS----------T-QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAP 173 (350)
Q Consensus 105 v~~sp~g~~la~~s~d----------~-~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~ 173 (350)
++.+|.|.-||....+ . .|+||+.. |+.+..+...+ +.|.++.|+.+ ..|++...||.++++|+
T Consensus 34 va~a~~gGpIAi~~d~~k~~~~~~~~p~~I~iys~s---G~ll~~i~w~~-~~iv~~~wt~~-e~LvvV~~dG~v~vy~~ 108 (410)
T PF04841_consen 34 VAVAPYGGPIAIIRDESKLVPVGSAKPNSIQIYSSS---GKLLSSIPWDS-GRIVGMGWTDD-EELVVVQSDGTVRVYDL 108 (410)
T ss_pred EEEcCCCceEEEEecCcccccccCCCCcEEEEECCC---CCEeEEEEECC-CCEEEEEECCC-CeEEEEEcCCEEEEEeC
Confidence 4566667666665433 1 48888864 66666655445 78999999987 88999999999999998
Q ss_pred CCCCCCceeecc----------------cccccceecCCCCCceEEeeeccCC--------CCCceee----------EE
Q 018806 174 SYPGNAASVRSG----------------AASFLGALSRGPGTRWTLVDFLRSQ--------NGEQITA----------LS 219 (350)
Q Consensus 174 ~~~~~~~~~~~~----------------~~~~~~~~~~~~~~~~~~~~~~~~~--------~~~~v~~----------~~ 219 (350)
. +.. .+..+ .....+-+....+..+.....+... ....... ..
T Consensus 109 ~-G~~--~fsl~~~i~~~~v~e~~i~~~~~~~~GivvLt~~~~~~~v~n~~~~~~~~~~~~~p~~~~~~~~~~~~~~i~~ 185 (410)
T PF04841_consen 109 F-GEF--QFSLGEEIEEEKVLECRIFAIWFYKNGIVVLTGNNRFYVVNNIDEPVKLRRLPEIPGLWTKFHWWPSWTVIPL 185 (410)
T ss_pred C-Cce--eechhhhccccCcccccccccccCCCCEEEECCCCeEEEEeCccccchhhccccCCCcccccccccccccceE
Confidence 5 222 11100 0000111111222222222211110 0000000 11
Q ss_pred ECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cc-cCCCC
Q 018806 220 WGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WS-STSGF 297 (350)
Q Consensus 220 ~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~-~~~~~ 297 (350)
++.+....+....+ +.+.+.+-...+. ....+++..++.||+|++||.-..+|.+.+...+-.+... +. .....
T Consensus 186 l~~~~~~~i~~~~g-~~i~~i~~~~~~~---i~~~~~i~~iavSpng~~iAl~t~~g~l~v~ssDf~~~~~e~~~~~~~~ 261 (410)
T PF04841_consen 186 LSSDRVVEILLANG-ETIYIIDENSFKQ---IDSDGPIIKIAVSPNGKFIALFTDSGNLWVVSSDFSEKLCEFDTDSKSP 261 (410)
T ss_pred eecCcceEEEEecC-CEEEEEEcccccc---ccCCCCeEEEEECCCCCEEEEEECCCCEEEEECcccceeEEeecCcCCC
Confidence 22233333333333 2444333222111 2234689999999999999999999999998765544421 11 22345
Q ss_pred eEEEEEcCCCC
Q 018806 298 VTGATWDPEGR 308 (350)
Q Consensus 298 v~~~~~s~~g~ 308 (350)
...|.|.-+..
T Consensus 262 p~~~~WCG~da 272 (410)
T PF04841_consen 262 PKQMAWCGNDA 272 (410)
T ss_pred CcEEEEECCCc
Confidence 66777776543
No 323
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=97.99 E-value=3.4e-05 Score=61.76 Aligned_cols=72 Identities=14% Similarity=0.226 Sum_probs=60.1
Q ss_pred CeeEEEEecCC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC-CCeEEEEecCCcEEEEecC
Q 018806 101 DLQGVSWHQHK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN-GGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-~~~l~~~~~d~~v~iwd~~ 174 (350)
.|++++-+|.. +.+++|+.||.+-+||+.. ...+..+...|+.+|+.+.|+|. +.+|++++.||.+--||..
T Consensus 181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn--~~~p~S~l~ahk~~i~eV~FHpk~p~~Lft~sedGslw~wdas 254 (319)
T KOG4714|consen 181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARN--VAMPVSLLKAHKAEIWEVHFHPKNPEHLFTCSEDGSLWHWDAS 254 (319)
T ss_pred cchhhhCCcccccEEEEecCCCeEEEEEccc--ccchHHHHHHhhhhhhheeccCCCchheeEecCCCcEEEEcCC
Confidence 58999999965 5666788899999999964 45556666789999999999985 5689999999999999987
No 324
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=97.96 E-value=0.0095 Score=53.10 Aligned_cols=194 Identities=18% Similarity=0.173 Sum_probs=123.4
Q ss_pred eeEEEEecCCCEEEEEECCC-eEEEEEccCCCCCceeEecCCCC-CCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGST-QVIVRDYEDSEGKDACILTSDSQ-RDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGN 178 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~-~i~iw~~~~~~~~~~~~~~~~~~-~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~ 178 (350)
...+...+++..+....... .+...+.. ... ......-. ..-..++.++.+.+++....+ +.|.+.|......
T Consensus 33 ~~~v~~~~~g~~~~v~~~~~~~~~~~~~~---~n~-~~~~~~~g~~~p~~i~v~~~~~~vyv~~~~~~~v~vid~~~~~~ 108 (381)
T COG3391 33 PGGVAVNPDGTQVYVANSGSNDVSVIDAT---SNT-VTQSLSVGGVYPAGVAVNPAGNKVYVTTGDSNTVSVIDTATNTV 108 (381)
T ss_pred CceeEEcCccCEEEEEeecCceeeecccc---cce-eeeeccCCCccccceeeCCCCCeEEEecCCCCeEEEEcCcccce
Confidence 55677788885555543322 33333331 111 11111111 334577888887767666654 8999999664433
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC--CCeEEEEeCCCCCceeeee-cCC
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYE--SSSFTIWDVAQGLGTPIRR-GFG 255 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~~~~~~~~~~-~~~ 255 (350)
......+ .....++++|+++.++.+... ++++.+.|..+.+...... ...
T Consensus 109 ~~~~~vG---------------------------~~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~~~~vG~~ 161 (381)
T COG3391 109 LGSIPVG---------------------------LGPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTATIPVGNT 161 (381)
T ss_pred eeEeeec---------------------------cCCceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEEEEecCCC
Confidence 3222221 256789999999988887662 3599999988887655422 223
Q ss_pred CeEEEEEcCCCCEEEEEe-cCCeEEEEeCCCCceec-----cccCCCCeEEEEEcCCCCEEEEEECCC--eEEEEEEeCC
Q 018806 256 GLSILKWSPTGDYFFAAK-FDGTFYLWETNTWTSEP-----WSSTSGFVTGATWDPEGRMILLAFAGS--LTLGSIHFAS 327 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~~~~~~~-----~~~~~~~v~~~~~s~~g~~l~~~~~~~--~~~~~~~~~~ 327 (350)
+ ..++++|+|+.++... .++.|.+.|..+....+ ..........++++|+|..+++..... ..+..++...
T Consensus 162 P-~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~~v~~~~~~~~~~~~~~P~~i~v~~~g~~~yV~~~~~~~~~v~~id~~~ 240 (381)
T COG3391 162 P-TGVAVDPDGNKVYVTNSDDNTVSVIDTSGNSVVRGSVGSLVGVGTGPAGIAVDPDGNRVYVANDGSGSNNVLKIDTAT 240 (381)
T ss_pred c-ceEEECCCCCeEEEEecCCCeEEEEeCCCcceeccccccccccCCCCceEEECCCCCEEEEEeccCCCceEEEEeCCC
Confidence 4 8899999999776654 68899999987766653 122334457789999999988887554 4666665544
No 325
>PRK13616 lipoprotein LpqB; Provisional
Probab=97.94 E-value=0.0029 Score=59.29 Aligned_cols=187 Identities=13% Similarity=0.120 Sum_probs=104.2
Q ss_pred cCeeEEEEecCCCEEEEEE------CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC-CcEEEEe
Q 018806 100 VDLQGVSWHQHKHIVAFIS------GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK-GGICIWA 172 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s------~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd 172 (350)
..+.+.++||+|+.+|+.. .|..-.||-.... +.. ..++.+ .......|+|+|+.+.+.... ..+++.+
T Consensus 350 ~~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~g-g~~-~~lt~g--~~~t~PsWspDG~~lw~v~dg~~~~~v~~ 425 (591)
T PRK13616 350 GNITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLG-GVA-VQVLEG--HSLTRPSWSLDADAVWVVVDGNTVVRVIR 425 (591)
T ss_pred cCcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCC-Ccc-eeeecC--CCCCCceECCCCCceEEEecCcceEEEec
Confidence 4688999999999998866 2554556655422 222 333333 248899999998877776543 2233333
Q ss_pred cCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEE---EeCCCCCcee
Q 018806 173 PSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTI---WDVAQGLGTP 249 (350)
Q Consensus 173 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~i---wd~~~~~~~~ 249 (350)
.........+.... ........+.|..+.|||||+.++... + |.|++ -....|....
T Consensus 426 ~~~~gql~~~~vd~------------------ge~~~~~~g~Issl~wSpDG~RiA~i~-~-g~v~Va~Vvr~~~G~~~l 485 (591)
T PRK13616 426 DPATGQLARTPVDA------------------SAVASRVPGPISELQLSRDGVRAAMII-G-GKVYLAVVEQTEDGQYAL 485 (591)
T ss_pred cCCCceEEEEeccC------------------chhhhccCCCcCeEEECCCCCEEEEEE-C-CEEEEEEEEeCCCCceee
Confidence 22111111000000 000001135799999999999999876 4 57877 4444454111
Q ss_pred -----eeecCC-CeEEEEEcCCCCEEEEEecCC--eEEEEeCCCCceecccc--CCCCeEEEEEcCCCCEEEEE
Q 018806 250 -----IRRGFG-GLSILKWSPTGDYFFAAKFDG--TFYLWETNTWTSEPWSS--TSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 250 -----~~~~~~-~v~~~~~sp~g~~l~~~~~d~--~v~iwd~~~~~~~~~~~--~~~~v~~~~~s~~g~~l~~~ 313 (350)
+..... .+.++.|..++.++ ++..++ .++..++.......+.. ....+..++=+++ .|+++
T Consensus 486 ~~~~~l~~~l~~~~~~l~W~~~~~L~-V~~~~~~~~v~~v~vDG~~~~~~~~~n~~~~v~~vaa~~~--~iyv~ 556 (591)
T PRK13616 486 TNPREVGPGLGDTAVSLDWRTGDSLV-VGRSDPEHPVWYVNLDGSNSDALPSRNLSAPVVAVAASPS--TVYVT 556 (591)
T ss_pred cccEEeecccCCccccceEecCCEEE-EEecCCCCceEEEecCCccccccCCCCccCceEEEecCCc--eEEEE
Confidence 222223 36889999999855 444443 45555555433322222 2566777877763 34444
No 326
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=97.93 E-value=0.00015 Score=67.93 Aligned_cols=141 Identities=14% Similarity=0.182 Sum_probs=98.8
Q ss_pred cCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---------CcEEEEecCCCCCC
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---------GGICIWAPSYPGNA 179 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---------~~v~iwd~~~~~~~ 179 (350)
.+++.+.+|...|+|.+-|... .+.+..+ ..|.+.|.++..+ |+.|+++|.. ..|+|||++.-+..
T Consensus 185 ~Nnr~lf~G~t~G~V~LrD~~s--~~~iht~-~aHs~siSDfDv~--GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral 259 (1118)
T KOG1275|consen 185 YNNRNLFCGDTRGTVFLRDPNS--FETIHTF-DAHSGSISDFDVQ--GNLLITCGYSMRRYNLAMDPFVKVYDLRMMRAL 259 (1118)
T ss_pred ecCcEEEeecccceEEeecCCc--Cceeeee-eccccceeeeecc--CCeEEEeecccccccccccchhhhhhhhhhhcc
Confidence 4678899999999999999853 4444555 5799999876654 6788888754 34789999844332
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC-CCeEEEEEeCCCeEEEEe---CCCCCc-eeeee-c
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD-GRYLASASYESSSFTIWD---VAQGLG-TPIRR-G 253 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~-g~~l~~~~~d~g~i~iwd---~~~~~~-~~~~~-~ 253 (350)
..+ .-+ ....-+.|.|. ...++.++.. |...+-| +..... ..+.. .
T Consensus 260 ~PI-------------------------~~~--~~P~flrf~Psl~t~~~V~S~s-Gq~q~vd~~~lsNP~~~~~~v~p~ 311 (1118)
T KOG1275|consen 260 SPI-------------------------QFP--YGPQFLRFHPSLTTRLAVTSQS-GQFQFVDTATLSNPPAGVKMVNPN 311 (1118)
T ss_pred CCc-------------------------ccc--cCchhhhhcccccceEEEEecc-cceeeccccccCCCccceeEEccC
Confidence 222 111 12345677775 4566667777 7999988 333322 22222 2
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEe
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWE 282 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd 282 (350)
...+..++++++|+.++.+..+|.|.+|.
T Consensus 312 ~s~i~~fDiSsn~~alafgd~~g~v~~wa 340 (1118)
T KOG1275|consen 312 GSGISAFDISSNGDALAFGDHEGHVNLWA 340 (1118)
T ss_pred CCcceeEEecCCCceEEEecccCcEeeec
Confidence 34599999999999999999999999997
No 327
>PRK02888 nitrous-oxide reductase; Validated
Probab=97.92 E-value=0.00055 Score=62.88 Aligned_cols=111 Identities=14% Similarity=0.070 Sum_probs=70.6
Q ss_pred ceeeEEECCCCCeEEEEEe---CCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC-----
Q 018806 214 QITALSWGPDGRYLASASY---ESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNT----- 285 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~---d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~----- 285 (350)
....++++|+|+++++++. ..+++...+.........+.-. . .-++.++|++... .++.|.+.|..+
T Consensus 236 npd~v~~spdGk~afvTsyNsE~G~tl~em~a~e~d~~vvfni~-~--iea~vkdGK~~~V--~gn~V~VID~~t~~~~~ 310 (635)
T PRK02888 236 NLDNVDTDYDGKYAFSTCYNSEEGVTLAEMMAAERDWVVVFNIA-R--IEEAVKAGKFKTI--GGSKVPVVDGRKAANAG 310 (635)
T ss_pred CcccceECCCCCEEEEeccCcccCcceeeeccccCceEEEEchH-H--HHHhhhCCCEEEE--CCCEEEEEECCccccCC
Confidence 4567899999999988863 2234444443322211111100 0 0134568887665 367899999998
Q ss_pred CceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCC
Q 018806 286 WTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKP 329 (350)
Q Consensus 286 ~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~ 329 (350)
.+......-......++++|||+++++++..+..+-.+++....
T Consensus 311 ~~v~~yIPVGKsPHGV~vSPDGkylyVanklS~tVSVIDv~k~k 354 (635)
T PRK02888 311 SALTRYVPVPKNPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLD 354 (635)
T ss_pred cceEEEEECCCCccceEECCCCCEEEEeCCCCCcEEEEEChhhh
Confidence 34455555667789999999999999998655566666665433
No 328
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=97.91 E-value=0.00061 Score=64.00 Aligned_cols=171 Identities=12% Similarity=0.161 Sum_probs=107.1
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccccccc
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFL 190 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~ 190 (350)
+..++.|+-...+..+|+.. .+...... -..+.|.-++- +++.++++...|+|.+-|...-
T Consensus 147 ~~~~i~Gg~Q~~li~~Dl~~--~~e~r~~~-v~a~~v~imR~--Nnr~lf~G~t~G~V~LrD~~s~-------------- 207 (1118)
T KOG1275|consen 147 PSTLIMGGLQEKLIHIDLNT--EKETRTTN-VSASGVTIMRY--NNRNLFCGDTRGTVFLRDPNSF-------------- 207 (1118)
T ss_pred Ccceeecchhhheeeeeccc--ceeeeeee-ccCCceEEEEe--cCcEEEeecccceEEeecCCcC--------------
Confidence 34555565555566677743 33333222 22334666654 3355555555799999998732
Q ss_pred ceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC--------CeEEEEeCCCCCceeeeecCCCeEEEEE
Q 018806 191 GALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES--------SSFTIWDVAQGLGTPIRRGFGGLSILKW 262 (350)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~--------g~i~iwd~~~~~~~~~~~~~~~v~~~~~ 262 (350)
....++..|. +.+.++.. .|+.|++++... -.|++||++..+...=..-.....-+.|
T Consensus 208 -----------~~iht~~aHs-~siSDfDv--~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmral~PI~~~~~P~flrf 273 (1118)
T KOG1275|consen 208 -----------ETIHTFDAHS-GSISDFDV--QGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRALSPIQFPYGPQFLRF 273 (1118)
T ss_pred -----------ceeeeeeccc-cceeeeec--cCCeEEEeecccccccccccchhhhhhhhhhhccCCcccccCchhhhh
Confidence 3356677776 57776554 588888886531 2689999987654432222223355778
Q ss_pred cCC-CCEEEEEecCCeEEEEeCC---CCce--eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 263 SPT-GDYFFAAKFDGTFYLWETN---TWTS--EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 263 sp~-g~~l~~~~~d~~v~iwd~~---~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.|. -..+++++..|...+-|.. +... .........+..+.+|++|+.|+++.
T Consensus 274 ~Psl~t~~~V~S~sGq~q~vd~~~lsNP~~~~~~v~p~~s~i~~fDiSsn~~alafgd 331 (1118)
T KOG1275|consen 274 HPSLTTRLAVTSQSGQFQFVDTATLSNPPAGVKMVNPNGSGISAFDISSNGDALAFGD 331 (1118)
T ss_pred cccccceEEEEecccceeeccccccCCCccceeEEccCCCcceeEEecCCCceEEEec
Confidence 885 4567888889999999843 3222 12223445599999999999999985
No 329
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=97.89 E-value=0.00083 Score=60.41 Aligned_cols=143 Identities=15% Similarity=0.136 Sum_probs=78.4
Q ss_pred CCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC
Q 018806 144 QRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD 223 (350)
Q Consensus 144 ~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 223 (350)
.-....+.++|+|+ +++...+|...|+....... . ..+....++|.+.
T Consensus 32 ~~~p~~ls~npngr-~v~V~g~geY~iyt~~~~r~-------------------------k------~~G~g~~~vw~~~ 79 (443)
T PF04053_consen 32 EIYPQSLSHNPNGR-FVLVCGDGEYEIYTALAWRN-------------------------K------AFGSGLSFVWSSR 79 (443)
T ss_dssp SS--SEEEE-TTSS-EEEEEETTEEEEEETTTTEE-------------------------E------EEEE-SEEEE-TS
T ss_pred CcCCeeEEECCCCC-EEEEEcCCEEEEEEccCCcc-------------------------c------ccCceeEEEEecC
Confidence 34578999999955 55557788888887331100 0 0145677899996
Q ss_pred CCeEEEEEeCCCeEEEE-eCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEE
Q 018806 224 GRYLASASYESSSFTIW-DVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGAT 302 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iw-d~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~ 302 (350)
++ +|+-... .+|.++ +........+ .....+..+-. |..|+..+. +.|.+||..+++........ .|..+.
T Consensus 80 n~-yAv~~~~-~~I~I~kn~~~~~~k~i-~~~~~~~~If~---G~LL~~~~~-~~i~~yDw~~~~~i~~i~v~-~vk~V~ 151 (443)
T PF04053_consen 80 NR-YAVLESS-STIKIYKNFKNEVVKSI-KLPFSVEKIFG---GNLLGVKSS-DFICFYDWETGKLIRRIDVS-AVKYVI 151 (443)
T ss_dssp SE-EEEE-TT-S-EEEEETTEE-TT------SS-EEEEE----SSSEEEEET-TEEEEE-TTT--EEEEESS--E-EEEE
T ss_pred cc-EEEEECC-CeEEEEEcCccccceEE-cCCcccceEEc---CcEEEEECC-CCEEEEEhhHcceeeEEecC-CCcEEE
Confidence 65 5555445 489996 4432221122 12222333322 887777664 48999999999886555443 389999
Q ss_pred EcCCCCEEEEEECCCeEEEEEEeC
Q 018806 303 WDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 303 ~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
|+++|.+++..+.....+...+..
T Consensus 152 Ws~~g~~val~t~~~i~il~~~~~ 175 (443)
T PF04053_consen 152 WSDDGELVALVTKDSIYILKYNLE 175 (443)
T ss_dssp E-TTSSEEEEE-S-SEEEEEE-HH
T ss_pred EECCCCEEEEEeCCeEEEEEecch
Confidence 999999999998877777666655
No 330
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=97.87 E-value=0.0074 Score=51.47 Aligned_cols=198 Identities=11% Similarity=-0.016 Sum_probs=107.3
Q ss_pred cCCCCcCCCCccCeeEEEEecCCCEEEEEE--CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCC
Q 018806 89 LHPDHVHLLPEVDLQGVSWHQHKHIVAFIS--GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKG 166 (350)
Q Consensus 89 ~~p~~~~~~~~~~V~~v~~sp~g~~la~~s--~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~ 166 (350)
..|..++.+.......+++|.||++++... -...|.|-|+.. .+....+. -.+ +..+--+.+ +.+.+.+.||
T Consensus 84 ~iP~k~R~~~~~~~~~~~ls~dgk~~~V~N~TPa~SVtVVDl~~--~kvv~ei~--~PG-C~~iyP~~~-~~F~~lC~DG 157 (342)
T PF06433_consen 84 EIPPKPRAQVVPYKNMFALSADGKFLYVQNFTPATSVTVVDLAA--KKVVGEID--TPG-CWLIYPSGN-RGFSMLCGDG 157 (342)
T ss_dssp EETTS-B--BS--GGGEEE-TTSSEEEEEEESSSEEEEEEETTT--TEEEEEEE--GTS-EEEEEEEET-TEEEEEETTS
T ss_pred ecCCcchheecccccceEEccCCcEEEEEccCCCCeEEEEECCC--Cceeeeec--CCC-EEEEEecCC-CceEEEecCC
Confidence 455554444444566778999999988854 356788888853 44444442 222 333322333 5677888899
Q ss_pred cEEEEecCCCCCCceeecccccccce--ecC----CCCCceE----------------------Eeeecc------CCCC
Q 018806 167 GICIWAPSYPGNAASVRSGAASFLGA--LSR----GPGTRWT----------------------LVDFLR------SQNG 212 (350)
Q Consensus 167 ~v~iwd~~~~~~~~~~~~~~~~~~~~--~~~----~~~~~~~----------------------~~~~~~------~~~~ 212 (350)
.+.-..+...++.....+.-+..... +.. ..++.+. .+..+. +-.+
T Consensus 158 sl~~v~Ld~~Gk~~~~~t~~F~~~~dp~f~~~~~~~~~~~~~F~Sy~G~v~~~dlsg~~~~~~~~~~~~t~~e~~~~WrP 237 (342)
T PF06433_consen 158 SLLTVTLDADGKEAQKSTKVFDPDDDPLFEHPAYSRDGGRLYFVSYEGNVYSADLSGDSAKFGKPWSLLTDAEKADGWRP 237 (342)
T ss_dssp CEEEEEETSTSSEEEEEEEESSTTTS-B-S--EEETTTTEEEEEBTTSEEEEEEETTSSEEEEEEEESS-HHHHHTTEEE
T ss_pred ceEEEEECCCCCEeEeeccccCCCCcccccccceECCCCeEEEEecCCEEEEEeccCCcccccCcccccCccccccCcCC
Confidence 99888888666554332222222111 000 0111111 011000 1112
Q ss_pred CceeeEEECCCCCeEEEEEeCC--C-------eEEEEeCCCCCceeeeecCCCeEEEEEcCCCC-EEEEE-ecCCeEEEE
Q 018806 213 EQITALSWGPDGRYLASASYES--S-------SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGD-YFFAA-KFDGTFYLW 281 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~--g-------~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~-~l~~~-~~d~~v~iw 281 (350)
+...-+++++...+|+...... | .|.++|+.+++......-..++.+++.+.+.+ +|++. ..++.+.+|
T Consensus 238 GG~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgteVWv~D~~t~krv~Ri~l~~~~~Si~Vsqd~~P~L~~~~~~~~~l~v~ 317 (342)
T PF06433_consen 238 GGWQLIAYHAASGRLYVLMHQGGEGSHKDPGTEVWVYDLKTHKRVARIPLEHPIDSIAVSQDDKPLLYALSAGDGTLDVY 317 (342)
T ss_dssp -SSS-EEEETTTTEEEEEEEE--TT-TTS-EEEEEEEETTTTEEEEEEEEEEEESEEEEESSSS-EEEEEETTTTEEEEE
T ss_pred cceeeeeeccccCeEEEEecCCCCCCccCCceEEEEEECCCCeEEEEEeCCCccceEEEccCCCcEEEEEcCCCCeEEEE
Confidence 2334567776555555432210 1 68888999998876666566788999998876 55444 457899999
Q ss_pred eCCCCceeccc
Q 018806 282 ETNTWTSEPWS 292 (350)
Q Consensus 282 d~~~~~~~~~~ 292 (350)
|..+++.....
T Consensus 318 D~~tGk~~~~~ 328 (342)
T PF06433_consen 318 DAATGKLVRSI 328 (342)
T ss_dssp ETTT--EEEEE
T ss_pred eCcCCcEEeeh
Confidence 99999885433
No 331
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=97.87 E-value=0.00059 Score=62.97 Aligned_cols=151 Identities=20% Similarity=0.251 Sum_probs=97.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCC----------CeEEEEecC--CcE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNG----------GRSLSVGCK--GGI 168 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~----------~~l~~~~~d--~~v 168 (350)
.-.++.|+|.| +||+|+.. .|.+-|.. +-+.+..+ ..|...|+.++|.|-. ..++.++.| |.|
T Consensus 17 N~~A~Dw~~~G-LiAygshs-lV~VVDs~--s~q~iqsi-e~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD~~GrI 91 (1062)
T KOG1912|consen 17 NRNAADWSPSG-LIAYGSHS-LVSVVDSR--SLQLIQSI-ELHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASADISGRI 91 (1062)
T ss_pred cccccccCccc-eEEEecCc-eEEEEehh--hhhhhhcc-ccCccceeEEEeccCCCchhccCccccceeEEeccccCcE
Confidence 46778899877 67777654 46676763 34444444 3688999999997631 234444444 999
Q ss_pred EEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC---CCC-eEEEEEeCCCeEEEEeCCC
Q 018806 169 CIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP---DGR-YLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 169 ~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp---~g~-~l~~~~~d~g~i~iwd~~~ 244 (350)
.+||+........ +..+. .++..+.|-+ +.+ .|+.-...+ ++.+|+..+
T Consensus 92 il~d~~~~s~~~~-------------------------l~~~~-~~~qdl~W~~~rd~Srd~LlaIh~ss-~lvLwntdt 144 (1062)
T KOG1912|consen 92 ILVDFVLASVINW-------------------------LSHSN-DSVQDLCWVPARDDSRDVLLAIHGSS-TLVLWNTDT 144 (1062)
T ss_pred EEEEehhhhhhhh-------------------------hcCCC-cchhheeeeeccCcchheeEEecCCc-EEEEEEccC
Confidence 9999984433322 33333 5778888865 443 455555554 999999999
Q ss_pred CCceeeeec-CCCeEEEEEcC-CCCEEEEEecCCeEEEEeC
Q 018806 245 GLGTPIRRG-FGGLSILKWSP-TGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 245 ~~~~~~~~~-~~~v~~~~~sp-~g~~l~~~~~d~~v~iwd~ 283 (350)
|+....... +....|+.+.| |.+.+..-+..|.+-+-+.
T Consensus 145 G~k~Wk~~ys~~iLs~f~~DPfd~rh~~~l~s~g~vl~~~~ 185 (1062)
T KOG1912|consen 145 GEKFWKYDYSHEILSCFRVDPFDSRHFCVLGSKGFVLSCKD 185 (1062)
T ss_pred CceeeccccCCcceeeeeeCCCCcceEEEEccCceEEEEec
Confidence 987654443 34456688888 5666666555666555543
No 332
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.85 E-value=0.00041 Score=64.18 Aligned_cols=143 Identities=14% Similarity=0.087 Sum_probs=104.1
Q ss_pred CCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC
Q 018806 145 RDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG 224 (350)
Q Consensus 145 ~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g 224 (350)
..+.+++++ +..++.+..+|.|++++..... .. ...|.. . .-+|
T Consensus 40 D~is~~av~--~~~~~~GtH~g~v~~~~~~~~~--~~-------------------------~~~~s~-~------~~~G 83 (846)
T KOG2066|consen 40 DAISCCAVH--DKFFALGTHRGAVYLTTCQGNP--KT-------------------------NFDHSS-S------ILEG 83 (846)
T ss_pred hHHHHHHhh--cceeeeccccceEEEEecCCcc--cc-------------------------cccccc-c------ccCC
Confidence 457777776 2566666668999999887221 11 111111 1 5579
Q ss_pred CeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCC-----CCEEEEEecCCeEEEEeCCC---CceeccccCCC
Q 018806 225 RYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPT-----GDYFFAAKFDGTFYLWETNT---WTSEPWSSTSG 296 (350)
Q Consensus 225 ~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~-----g~~l~~~~~d~~v~iwd~~~---~~~~~~~~~~~ 296 (350)
.++++++.| |+|.|-.+-+.+.......+.++.+++++|+ .+.+++|+..| +.++.-+- .....+....+
T Consensus 84 ey~asCS~D-Gkv~I~sl~~~~~~~~~df~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~wlgnk~~v~l~~~eG 161 (846)
T KOG2066|consen 84 EYVASCSDD-GKVVIGSLFTDDEITQYDFKRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNWLGNKDSVVLSEGEG 161 (846)
T ss_pred ceEEEecCC-CcEEEeeccCCccceeEecCCcceeEEeccchhhhhhhheeecCcce-EEEehhhhhcCccceeeecCcc
Confidence 999999999 7999999988887777777889999999998 56788888888 76764321 11233556678
Q ss_pred CeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 297 FVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
+|.++.|. |.++|.+.+.++++++.....
T Consensus 162 ~I~~i~W~--g~lIAWand~Gv~vyd~~~~~ 190 (846)
T KOG2066|consen 162 PIHSIKWR--GNLIAWANDDGVKVYDTPTRQ 190 (846)
T ss_pred ceEEEEec--CcEEEEecCCCcEEEeccccc
Confidence 99999997 889999998888888876543
No 333
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=97.84 E-value=0.012 Score=48.61 Aligned_cols=186 Identities=13% Similarity=0.028 Sum_probs=105.7
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccc
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASF 189 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~ 189 (350)
++.++++++.++.+..||..+ ++..-.... ...+..... .++..+++...++.++.+|...+.........
T Consensus 35 ~~~~v~~~~~~~~l~~~d~~t--G~~~W~~~~--~~~~~~~~~-~~~~~v~v~~~~~~l~~~d~~tG~~~W~~~~~---- 105 (238)
T PF13360_consen 35 DGGRVYVASGDGNLYALDAKT--GKVLWRFDL--PGPISGAPV-VDGGRVYVGTSDGSLYALDAKTGKVLWSIYLT---- 105 (238)
T ss_dssp ETTEEEEEETTSEEEEEETTT--SEEEEEEEC--SSCGGSGEE-EETTEEEEEETTSEEEEEETTTSCEEEEEEE-----
T ss_pred eCCEEEEEcCCCEEEEEECCC--CCEEEEeec--cccccceee-ecccccccccceeeeEecccCCcceeeeeccc----
Confidence 566777778999999999844 655444432 222222222 33467777778889999997744432221000
Q ss_pred cceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCC-C----------eE
Q 018806 190 LGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFG-G----------LS 258 (350)
Q Consensus 190 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~-~----------v~ 258 (350)
..... ..........++..++++..+ |.|..+|.++|+......... . +.
T Consensus 106 ----------------~~~~~--~~~~~~~~~~~~~~~~~~~~~-g~l~~~d~~tG~~~w~~~~~~~~~~~~~~~~~~~~ 166 (238)
T PF13360_consen 106 ----------------SSPPA--GVRSSSSPAVDGDRLYVGTSS-GKLVALDPKTGKLLWKYPVGEPRGSSPISSFSDIN 166 (238)
T ss_dssp ----------------SSCTC--STB--SEEEEETTEEEEEETC-SEEEEEETTTTEEEEEEESSTT-SS--EEEETTEE
T ss_pred ----------------ccccc--ccccccCceEecCEEEEEecc-CcEEEEecCCCcEEEEeecCCCCCCcceeeecccc
Confidence 00000 111222222237778777777 699999999998754332211 1 11
Q ss_pred EEEEcCCCCEEEEEecCCe-EEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 259 ILKWSPTGDYFFAAKFDGT-FYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~-v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
.-....++ .++.++.++. +.+ |+++++.. +......+.. ....++..|++++ .+..++.++....
T Consensus 167 ~~~~~~~~-~v~~~~~~g~~~~~-d~~tg~~~-w~~~~~~~~~-~~~~~~~~l~~~~-~~~~l~~~d~~tG 232 (238)
T PF13360_consen 167 GSPVISDG-RVYVSSGDGRVVAV-DLATGEKL-WSKPISGIYS-LPSVDGGTLYVTS-SDGRLYALDLKTG 232 (238)
T ss_dssp EEEECCTT-EEEEECCTSSEEEE-ETTTTEEE-EEECSS-ECE-CEECCCTEEEEEE-TTTEEEEEETTTT
T ss_pred cceEEECC-EEEEEcCCCeEEEE-ECCCCCEE-EEecCCCccC-CceeeCCEEEEEe-CCCEEEEEECCCC
Confidence 22222345 6666776775 555 99999865 3322233332 1457788888777 4567888876654
No 334
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=97.81 E-value=0.019 Score=51.93 Aligned_cols=198 Identities=14% Similarity=0.128 Sum_probs=109.0
Q ss_pred eeEEEEecCCCEEEEEE-CCC----eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCC----------
Q 018806 102 LQGVSWHQHKHIVAFIS-GST----QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKG---------- 166 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s-~d~----~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~---------- 166 (350)
+..+++||||++||.+- ..| .++++|+.+ ++.+..... ......+.|.++++.+++...+.
T Consensus 126 ~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~t--g~~l~d~i~--~~~~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~ 201 (414)
T PF02897_consen 126 LGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLET--GKFLPDGIE--NPKFSSVSWSDDGKGFFYTRFDEDQRTSDSGYP 201 (414)
T ss_dssp EEEEEETTTSSEEEEEEEETTSSEEEEEEEETTT--TEEEEEEEE--EEESEEEEECTTSSEEEEEECSTTTSS-CCGCC
T ss_pred eeeeeECCCCCEEEEEecCCCCceEEEEEEECCC--CcCcCCccc--ccccceEEEeCCCCEEEEEEeCcccccccCCCC
Confidence 45678999999999763 333 588888854 543332211 11123399999988888887652
Q ss_pred -cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCc-eeeEEECCCCCeEEEEEeCCC---eEEEEe
Q 018806 167 -GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQ-ITALSWGPDGRYLASASYESS---SFTIWD 241 (350)
Q Consensus 167 -~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-v~~~~~sp~g~~l~~~~~d~g---~i~iwd 241 (350)
.|+.|.+........+ .+....... ...+..++|+++|+....... .+++.|
T Consensus 202 ~~v~~~~~gt~~~~d~l-----------------------vfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d 258 (414)
T PF02897_consen 202 RQVYRHKLGTPQSEDEL-----------------------VFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLD 258 (414)
T ss_dssp EEEEEEETTS-GGG-EE-----------------------EEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEE
T ss_pred cEEEEEECCCChHhCee-----------------------EEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEe
Confidence 2566666533222111 112211122 567889999999876544321 578888
Q ss_pred CCCC-----CceeeeecCCCeEEEEEcCCCCEEEEEec---CCeEEEEeCCCCce---e-ccccCCCCeEEEEEcCCCCE
Q 018806 242 VAQG-----LGTPIRRGFGGLSILKWSPTGDYFFAAKF---DGTFYLWETNTWTS---E-PWSSTSGFVTGATWDPEGRM 309 (350)
Q Consensus 242 ~~~~-----~~~~~~~~~~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~~~~~---~-~~~~~~~~v~~~~~s~~g~~ 309 (350)
+..+ ....+......+....-+..+.+++.... ++.|...++..... . .+..+...+.-..+...+.+
T Consensus 259 ~~~~~~~~~~~~~l~~~~~~~~~~v~~~~~~~yi~Tn~~a~~~~l~~~~l~~~~~~~~~~~l~~~~~~~~l~~~~~~~~~ 338 (414)
T PF02897_consen 259 LDDGGSPDAKPKLLSPREDGVEYYVDHHGDRLYILTNDDAPNGRLVAVDLADPSPAEWWTVLIPEDEDVSLEDVSLFKDY 338 (414)
T ss_dssp CCCTTTSS-SEEEEEESSSS-EEEEEEETTEEEEEE-TT-TT-EEEEEETTSTSGGGEEEEEE--SSSEEEEEEEEETTE
T ss_pred ccccCCCcCCcEEEeCCCCceEEEEEccCCEEEEeeCCCCCCcEEEEecccccccccceeEEcCCCCceeEEEEEEECCE
Confidence 8875 34445554444443333334444444432 45777788887763 2 34455553333334445666
Q ss_pred EEEEE--CCCeEEEEEEeC
Q 018806 310 ILLAF--AGSLTLGSIHFA 326 (350)
Q Consensus 310 l~~~~--~~~~~~~~~~~~ 326 (350)
|+... ++...+..+++.
T Consensus 339 Lvl~~~~~~~~~l~v~~~~ 357 (414)
T PF02897_consen 339 LVLSYRENGSSRLRVYDLD 357 (414)
T ss_dssp EEEEEEETTEEEEEEEETT
T ss_pred EEEEEEECCccEEEEEECC
Confidence 66654 555667777666
No 335
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=97.80 E-value=0.00038 Score=64.83 Aligned_cols=76 Identities=14% Similarity=0.323 Sum_probs=62.3
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
...+++++|+|..-.||.|-.-|.+.+|.... .........|..+|..+.||++|..++++..-|.+.+|.....+
T Consensus 59 P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~---~e~htv~~th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d~~g 134 (1416)
T KOG3617|consen 59 PVHATSLCWHPEEFVLAQGWEMGVSDVQKTNT---TETHTVVETHPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYDVIG 134 (1416)
T ss_pred ceehhhhccChHHHHHhhccccceeEEEecCC---ceeeeeccCCCCCceeEEecCCCCeEEEcCCCceeEEEEeeecc
Confidence 34578899999999999998899999999753 33345555799999999999999988888777999999887433
No 336
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=97.77 E-value=0.00016 Score=65.04 Aligned_cols=91 Identities=18% Similarity=0.216 Sum_probs=72.6
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee-cCCCeE-EEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR-GFGGLS-ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~-~~~~v~-~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
..+.-+.|+|.-..||++..+ |.+.+..++ .+...... +...+. +++|.|||+.||+|-.||+|++-|++++....
T Consensus 21 ~~i~~~ewnP~~dLiA~~t~~-gelli~R~n-~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~I~L~Dve~~~~l~ 98 (665)
T KOG4640|consen 21 INIKRIEWNPKMDLIATRTEK-GELLIHRLN-WQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGTIRLHDVEKGGRLV 98 (665)
T ss_pred cceEEEEEcCccchhheeccC-CcEEEEEec-cceeEeccCCCCccceeeeecCCCCEEEEEecCCeEEEEEccCCCcee
Confidence 467889999999999999999 799998888 44444333 555555 99999999999999999999999999988743
Q ss_pred c--ccCCCCeEEEEEcC
Q 018806 291 W--SSTSGFVTGATWDP 305 (350)
Q Consensus 291 ~--~~~~~~v~~~~~s~ 305 (350)
- ..-...|..+-|++
T Consensus 99 ~~~~s~e~~is~~~w~~ 115 (665)
T KOG4640|consen 99 SFLFSVETDISKGIWDR 115 (665)
T ss_pred ccccccccchheeeccc
Confidence 2 44556778888874
No 337
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=97.75 E-value=0.01 Score=50.72 Aligned_cols=225 Identities=11% Similarity=0.107 Sum_probs=122.0
Q ss_pred eeEEEEecCCCEEEEEE----------CCCeEEEEEccCCCCCceeEecCCCC----CCeeEEEEeeCCCeEEEEec--C
Q 018806 102 LQGVSWHQHKHIVAFIS----------GSTQVIVRDYEDSEGKDACILTSDSQ----RDVKVLEWRPNGGRSLSVGC--K 165 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s----------~d~~i~iw~~~~~~~~~~~~~~~~~~----~~v~~~~~sp~~~~l~~~~~--d 165 (350)
.-.+..||+++.+++++ ..-.|.+||..+-.......+...|. .....++++.||++++..-. .
T Consensus 38 ~~~~~~spdgk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k~R~~~~~~~~~~~ls~dgk~~~V~N~TPa 117 (342)
T PF06433_consen 38 LGNVALSPDGKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPKPRAQVVPYKNMFALSADGKFLYVQNFTPA 117 (342)
T ss_dssp SEEEEE-TTSSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS-B--BS--GGGEEE-TTSSEEEEEEESSS
T ss_pred CCceeECCCCCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCcchheecccccceEEccCCcEEEEEccCCC
Confidence 34577899999888754 24468899986432222222321111 23355688888877776555 3
Q ss_pred CcEEEEecCCCCCCceeeccccccc------ceecCCCCCceEEee-------------eccCCCCCceeeEEECCCCCe
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFL------GALSRGPGTRWTLVD-------------FLRSQNGEQITALSWGPDGRY 226 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~------~~~~~~~~~~~~~~~-------------~~~~~~~~~v~~~~~sp~g~~ 226 (350)
..|.|-|+..++....+....+..+ .-...|.++.+..+. .+....+-....-++...+..
T Consensus 118 ~SVtVVDl~~~kvv~ei~~PGC~~iyP~~~~~F~~lC~DGsl~~v~Ld~~Gk~~~~~t~~F~~~~dp~f~~~~~~~~~~~ 197 (342)
T PF06433_consen 118 TSVTVVDLAAKKVVGEIDTPGCWLIYPSGNRGFSMLCGDGSLLTVTLDADGKEAQKSTKVFDPDDDPLFEHPAYSRDGGR 197 (342)
T ss_dssp EEEEEEETTTTEEEEEEEGTSEEEEEEEETTEEEEEETTSCEEEEEETSTSSEEEEEEEESSTTTS-B-S--EEETTTTE
T ss_pred CeEEEEECCCCceeeeecCCCEEEEEecCCCceEEEecCCceEEEEECCCCCEeEeeccccCCCCcccccccceECCCCe
Confidence 7788888885555444433322111 112334444332221 111111111123344445556
Q ss_pred EEEEEeCCCeEEEEeCCCCCceeeee-------------cCCCeEEEEEcCCCCEEEEEec---C-------CeEEEEeC
Q 018806 227 LASASYESSSFTIWDVAQGLGTPIRR-------------GFGGLSILKWSPTGDYFFAAKF---D-------GTFYLWET 283 (350)
Q Consensus 227 l~~~~~d~g~i~iwd~~~~~~~~~~~-------------~~~~v~~~~~sp~g~~l~~~~~---d-------~~v~iwd~ 283 (350)
++..+.+ |.|+--|+.......... ..++-.-+++++..+.|++... + ..|.++|+
T Consensus 198 ~~F~Sy~-G~v~~~dlsg~~~~~~~~~~~~t~~e~~~~WrPGG~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgteVWv~D~ 276 (342)
T PF06433_consen 198 LYFVSYE-GNVYSADLSGDSAKFGKPWSLLTDAEKADGWRPGGWQLIAYHAASGRLYVLMHQGGEGSHKDPGTEVWVYDL 276 (342)
T ss_dssp EEEEBTT-SEEEEEEETTSSEEEEEEEESS-HHHHHTTEEE-SSS-EEEETTTTEEEEEEEE--TT-TTS-EEEEEEEET
T ss_pred EEEEecC-CEEEEEeccCCcccccCcccccCccccccCcCCcceeeeeeccccCeEEEEecCCCCCCccCCceEEEEEEC
Confidence 6667778 788888887664322110 0134456888876666654322 1 15888999
Q ss_pred CCCceeccccCCCCeEEEEEcCCCCEEEEE-ECCCeEEEEEEeCC
Q 018806 284 NTWTSEPWSSTSGFVTGATWDPEGRMILLA-FAGSLTLGSIHFAS 327 (350)
Q Consensus 284 ~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~-~~~~~~~~~~~~~~ 327 (350)
.+++.........++.+++.+.+.+=++.+ ..++..+..++...
T Consensus 277 ~t~krv~Ri~l~~~~~Si~Vsqd~~P~L~~~~~~~~~l~v~D~~t 321 (342)
T PF06433_consen 277 KTHKRVARIPLEHPIDSIAVSQDDKPLLYALSAGDGTLDVYDAAT 321 (342)
T ss_dssp TTTEEEEEEEEEEEESEEEEESSSS-EEEEEETTTTEEEEEETTT
T ss_pred CCCeEEEEEeCCCccceEEEccCCCcEEEEEcCCCCeEEEEeCcC
Confidence 999886544445578899999988755544 45555666666554
No 338
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.71 E-value=0.0003 Score=64.10 Aligned_cols=113 Identities=15% Similarity=0.114 Sum_probs=84.8
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee--cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR--GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~--~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
..+.--+++..+++++.|+.. |.+++|+-..++...+.. ..+.+..++.|++..++|.|+..|.|.++-+.......
T Consensus 34 ~~v~lTc~dst~~~l~~GsS~-G~lyl~~R~~~~~~~~~~~~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql~~~~p~~ 112 (726)
T KOG3621|consen 34 ARVKLTCVDATEEYLAMGSSA-GSVYLYNRHTGEMRKLKNEGATGITCVRSVSSVEYLVAAGTASGRVSVFQLNKELPRD 112 (726)
T ss_pred ceEEEEEeecCCceEEEeccc-ceEEEEecCchhhhcccccCccceEEEEEecchhHhhhhhcCCceEEeehhhccCCCc
Confidence 345555667788999999988 799999988887655544 44567778889999999999999999999887644321
Q ss_pred -------cccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 291 -------WSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 291 -------~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
-..|...|++++|++|+..+++|.+. +.+-...+..
T Consensus 113 ~~~~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~-Gkv~~~~L~s 155 (726)
T KOG3621|consen 113 LDYVTPCDKSHKCRVTALEWSKNGMKLYSGDSQ-GKVVLTELDS 155 (726)
T ss_pred ceeeccccccCCceEEEEEecccccEEeecCCC-ceEEEEEech
Confidence 12467889999999999999987533 3555555544
No 339
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=97.60 E-value=0.00089 Score=57.14 Aligned_cols=147 Identities=14% Similarity=0.112 Sum_probs=91.4
Q ss_pred ecCCCCCCeeEEEEeeCCCe-EEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceee
Q 018806 139 LTSDSQRDVKVLEWRPNGGR-SLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITA 217 (350)
Q Consensus 139 ~~~~~~~~v~~~~~sp~~~~-l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~ 217 (350)
+...+...|.+++|||..+- +..++.+.+|+|.|++.... ...+..+ ..+++
T Consensus 188 ~lp~~g~~IrdlafSp~~~GLl~~asl~nkiki~dlet~~~-------------------------vssy~a~--~~~wS 240 (463)
T KOG1645|consen 188 ILPGEGSFIRDLAFSPFNEGLLGLASLGNKIKIMDLETSCV-------------------------VSSYIAY--NQIWS 240 (463)
T ss_pred cccccchhhhhhccCccccceeeeeccCceEEEEeccccee-------------------------eeheecc--CCcee
Confidence 33467888999999998653 45555689999999984332 2223333 58999
Q ss_pred EEECCCCCeEEEEEeCCCeEEEEeCCCCCcee--eee--cCCCeEEEE------EcCCCCEEEEEecCCeEEEEeCCCCc
Q 018806 218 LSWGPDGRYLASASYESSSFTIWDVAQGLGTP--IRR--GFGGLSILK------WSPTGDYFFAAKFDGTFYLWETNTWT 287 (350)
Q Consensus 218 ~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~--~~~--~~~~v~~~~------~sp~g~~l~~~~~d~~v~iwd~~~~~ 287 (350)
++|.-|..+.++++..+|.|.+||++..+... +.. ...+|..++ ..+.|.+++....+ +..|++....
T Consensus 241 C~wDlde~h~IYaGl~nG~VlvyD~R~~~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt~--l~f~ei~~s~ 318 (463)
T KOG1645|consen 241 CCWDLDERHVIYAGLQNGMVLVYDMRQPEGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALTV--LQFYEIVFSA 318 (463)
T ss_pred eeeccCCcceeEEeccCceEEEEEccCCCchHhhhhhhhccCcceeecccCccccccccceEEeeehh--hhhhhhhccc
Confidence 99999888887777777999999999764321 111 123333332 23345555554433 4556554322
Q ss_pred e----eccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 288 S----EPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 288 ~----~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
. ..-....+.+.++++.+-.+.++.+.
T Consensus 319 ~~~p~vlele~pG~cismqy~~~snh~l~ty 349 (463)
T KOG1645|consen 319 ECLPCVLELEPPGICISMQYHGVSNHLLLTY 349 (463)
T ss_pred cCCCcccccCCCcceeeeeecCccceEEEEe
Confidence 1 11123355677777777667766654
No 340
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.58 E-value=0.0052 Score=54.82 Aligned_cols=142 Identities=12% Similarity=0.049 Sum_probs=81.0
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCC---C------e-eEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQR---D------V-KVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~---~------v-~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
..++.+..++.+..+|..+ ++..-........ . + ..... .++.+++++.++.++.+|...++..
T Consensus 191 ~~v~~~~~~g~v~ald~~t--G~~~W~~~~~~~~g~~~~~~~~~~~~~p~~--~~~~vy~~~~~g~l~a~d~~tG~~~-- 264 (377)
T TIGR03300 191 GGVLVGFAGGKLVALDLQT--GQPLWEQRVALPKGRTELERLVDVDGDPVV--DGGQVYAVSYQGRVAALDLRSGRVL-- 264 (377)
T ss_pred CEEEEECCCCEEEEEEccC--CCEeeeeccccCCCCCchhhhhccCCccEE--ECCEEEEEEcCCEEEEEECCCCcEE--
Confidence 3566677778888888743 4332211111000 0 1 11112 2356777777889999998743321
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec-C-CCeEE
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG-F-GGLSI 259 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~-~~v~~ 259 (350)
|..-. .....+. .++..++.++.+ |.+..+|..+++....... . .....
T Consensus 265 ----------------------W~~~~----~~~~~p~--~~~~~vyv~~~~-G~l~~~d~~tG~~~W~~~~~~~~~~ss 315 (377)
T TIGR03300 265 ----------------------WKRDA----SSYQGPA--VDDNRLYVTDAD-GVVVALDRRSGSELWKNDELKYRQLTA 315 (377)
T ss_pred ----------------------Eeecc----CCccCce--EeCCEEEEECCC-CeEEEEECCCCcEEEccccccCCcccc
Confidence 11000 0111122 245677777777 7999999998876543311 1 12222
Q ss_pred EEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 260 LKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 260 ~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
... .+..|++++.+|.|+++|.++++...
T Consensus 316 p~i--~g~~l~~~~~~G~l~~~d~~tG~~~~ 344 (377)
T TIGR03300 316 PAV--VGGYLVVGDFEGYLHWLSREDGSFVA 344 (377)
T ss_pred CEE--ECCEEEEEeCCCEEEEEECCCCCEEE
Confidence 222 46688899999999999999998853
No 341
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=97.58 E-value=0.024 Score=48.59 Aligned_cols=103 Identities=17% Similarity=0.198 Sum_probs=69.6
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEEeCCC--CC---ce-eee--ecCCCeEEEEEcCCCCEEEEEecCC-eEEEEeCC
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIWDVAQ--GL---GT-PIR--RGFGGLSILKWSPTGDYFFAAKFDG-TFYLWETN 284 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~--~~---~~-~~~--~~~~~v~~~~~sp~g~~l~~~~~d~-~v~iwd~~ 284 (350)
..+.++||||++.++.+-...+.|..|++.. +. .. ... ...+..-.++...+|.+.+++..+| .|.+|+.+
T Consensus 164 ~~NGla~SpDg~tly~aDT~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a~~~g~~v~~~~pd 243 (307)
T COG3386 164 IPNGLAFSPDGKTLYVADTPANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAAVWGGGRVVRFNPD 243 (307)
T ss_pred ecCceEECCCCCEEEEEeCCCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEecccCCceEEEECCC
Confidence 4568999999998888766545888887762 21 11 111 2346677788888998876555444 89999998
Q ss_pred CCcee-ccccCCCCeEEEEE-cCCCCEEEEEECCC
Q 018806 285 TWTSE-PWSSTSGFVTGATW-DPEGRMILLAFAGS 317 (350)
Q Consensus 285 ~~~~~-~~~~~~~~v~~~~~-s~~g~~l~~~~~~~ 317 (350)
++.. ...-....+++++| .|+.+.|++++...
T Consensus 244 -G~l~~~i~lP~~~~t~~~FgG~~~~~L~iTs~~~ 277 (307)
T COG3386 244 -GKLLGEIKLPVKRPTNPAFGGPDLNTLYITSARS 277 (307)
T ss_pred -CcEEEEEECCCCCCccceEeCCCcCEEEEEecCC
Confidence 6663 33333367888888 55677777776443
No 342
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=97.57 E-value=0.026 Score=47.11 Aligned_cols=153 Identities=21% Similarity=0.334 Sum_probs=94.0
Q ss_pred CeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC
Q 018806 146 DVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG 224 (350)
Q Consensus 146 ~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g 224 (350)
.+.+.+++++++.+++... ++.-.+|-....+....+.. ...+...+|++++
T Consensus 25 ~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~~~~~~~~~~---------------------------g~~l~~PS~d~~g 77 (253)
T PF10647_consen 25 DVTSPAVSPDGSRVAAVSEGDGGRSLYVGPAGGPVRPVLT---------------------------GGSLTRPSWDPDG 77 (253)
T ss_pred cccceEECCCCCeEEEEEEcCCCCEEEEEcCCCcceeecc---------------------------CCccccccccCCC
Confidence 6899999999988887772 33333444343332222111 2477888999998
Q ss_pred CeEEEEEeCCCeEEEEe-CCCCCceeee--ec-C-CCeEEEEEcCCCCEEEEEe---cCCeEEEEeCC---CCce-----
Q 018806 225 RYLASASYESSSFTIWD-VAQGLGTPIR--RG-F-GGLSILKWSPTGDYFFAAK---FDGTFYLWETN---TWTS----- 288 (350)
Q Consensus 225 ~~l~~~~~d~g~i~iwd-~~~~~~~~~~--~~-~-~~v~~~~~sp~g~~l~~~~---~d~~v~iwd~~---~~~~----- 288 (350)
...+....+ ...+++. ...+...... .. . +.|..+++||||..+|... .++.|++--+. .+..
T Consensus 78 ~~W~v~~~~-~~~~~~~~~~~g~~~~~~v~~~~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~va~V~r~~~g~~~~l~~ 156 (253)
T PF10647_consen 78 WVWTVDDGS-GGVRVVRDSASGTGEPVEVDWPGLRGRITALRVSPDGTRVAVVVEDGGGGRVYVAGVVRDGDGVPRRLTG 156 (253)
T ss_pred CEEEEEcCC-CceEEEEecCCCcceeEEecccccCCceEEEEECCCCcEEEEEEecCCCCeEEEEEEEeCCCCCcceecc
Confidence 777666655 3666663 3444333222 11 1 2899999999999987665 34677776543 2211
Q ss_pred -eccc-cCCCCeEEEEEcCCCCEEEEEECCCeEEEE-EEeC
Q 018806 289 -EPWS-STSGFVTGATWDPEGRMILLAFAGSLTLGS-IHFA 326 (350)
Q Consensus 289 -~~~~-~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~-~~~~ 326 (350)
..+. .....+.+++|.+++.+++.+...+..+.. +...
T Consensus 157 ~~~~~~~~~~~v~~v~W~~~~~L~V~~~~~~~~~~~~v~~d 197 (253)
T PF10647_consen 157 PRRVAPPLLSDVTDVAWSDDSTLVVLGRSAGGPVVRLVSVD 197 (253)
T ss_pred ceEecccccCcceeeeecCCCEEEEEeCCCCCceeEEEEcc
Confidence 1111 335678999999999988877654444444 4443
No 343
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.51 E-value=0.0066 Score=58.03 Aligned_cols=97 Identities=13% Similarity=0.097 Sum_probs=67.9
Q ss_pred EEEEEeCCCeEEEEeCCCCCc--eeee----ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee-ccccCCCCeE
Q 018806 227 LASASYESSSFTIWDVAQGLG--TPIR----RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE-PWSSTSGFVT 299 (350)
Q Consensus 227 l~~~~~d~g~i~iwd~~~~~~--~~~~----~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~v~ 299 (350)
.+.|-.++ .+..||.+-... .... .......|++-+.+| +||+|+.+|.||+||--....+ .+.+.+.+|.
T Consensus 545 tflGls~n-~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs~~aTt~~G-~iavgs~~G~IRLyd~~g~~AKT~lp~lG~pI~ 622 (794)
T PF08553_consen 545 TFLGLSDN-SLFRIDPRLSGNKLVDSQSKQYSSKNNFSCFATTEDG-YIAVGSNKGDIRLYDRLGKRAKTALPGLGDPII 622 (794)
T ss_pred eEEEECCC-ceEEeccCCCCCceeeccccccccCCCceEEEecCCc-eEEEEeCCCcEEeecccchhhhhcCCCCCCCee
Confidence 34455554 899999986432 1111 123457788877777 6899999999999994332223 3456789999
Q ss_pred EEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 300 GATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 300 ~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
.+..+.||+||+++|..-..+....+
T Consensus 623 ~iDvt~DGkwilaTc~tyLlLi~t~~ 648 (794)
T PF08553_consen 623 GIDVTADGKWILATCKTYLLLIDTLI 648 (794)
T ss_pred EEEecCCCcEEEEeecceEEEEEEee
Confidence 99999999999988876555555544
No 344
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.47 E-value=3.4e-05 Score=69.33 Aligned_cols=156 Identities=15% Similarity=0.204 Sum_probs=94.8
Q ss_pred CeeEEEEec-CCCEEEEEE----CCCeEEEEEccCC--CCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEec
Q 018806 101 DLQGVSWHQ-HKHIVAFIS----GSTQVIVRDYEDS--EGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAP 173 (350)
Q Consensus 101 ~V~~v~~sp-~g~~la~~s----~d~~i~iw~~~~~--~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~ 173 (350)
..++++|++ |.++||.|- .|-.+.|||+... ..+....+..+......+++|-.+.+.++++...+.++++|+
T Consensus 104 ~Ct~lAwneLDtn~LAagldkhrnds~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr~~~ifdl 183 (783)
T KOG1008|consen 104 PCTSLAWNELDTNHLAAGLDKHRNDSSLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSRSVHIFDL 183 (783)
T ss_pred cccccccccccHHHHHhhhhhhcccCCccceecccccCCCccccccccccccCccccccccCcchhhcccccchhhhhhh
Confidence 688999988 567777763 3667899999653 112222222223445678999977555555556789999999
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC-CCCeEEEEEeCCCeEEEEeC-CCCC-ceee
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP-DGRYLASASYESSSFTIWDV-AQGL-GTPI 250 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~-~~~~-~~~~ 250 (350)
+........ +. ...+..+..+| .+.++++-. | |.|.+||. +.-+ ....
T Consensus 184 Rqs~~~~~s------------------------vn---Tk~vqG~tVdp~~~nY~cs~~-d-g~iAiwD~~rnienpl~~ 234 (783)
T KOG1008|consen 184 RQSLDSVSS------------------------VN---TKYVQGITVDPFSPNYFCSNS-D-GDIAIWDTYRNIENPLQI 234 (783)
T ss_pred hhhhhhhhh------------------------hh---hhhcccceecCCCCCceeccc-c-CceeeccchhhhccHHHH
Confidence 822111100 00 13566778888 566666554 6 69999994 3222 1111
Q ss_pred eec-----CCCeEEEEEcCCCC-EEEEE-ecCCeEEEEeCCC
Q 018806 251 RRG-----FGGLSILKWSPTGD-YFFAA-KFDGTFYLWETNT 285 (350)
Q Consensus 251 ~~~-----~~~v~~~~~sp~g~-~l~~~-~~d~~v~iwd~~~ 285 (350)
..+ ...+..++|+|... .+++. -..++|++||+..
T Consensus 235 i~~~~N~~~~~l~~~aycPtrtglla~l~RdS~tIrlydi~~ 276 (783)
T KOG1008|consen 235 ILRNENKKPKQLFALAYCPTRTGLLAVLSRDSITIRLYDICV 276 (783)
T ss_pred HhhCCCCcccceeeEEeccCCcchhhhhccCcceEEEecccc
Confidence 112 13488999999543 34444 4457999999853
No 345
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=97.47 E-value=0.024 Score=46.78 Aligned_cols=137 Identities=15% Similarity=0.077 Sum_probs=80.1
Q ss_pred CCeEEEEEccCCCCCceeEecCCCCCCeeEEE--EeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCC
Q 018806 120 STQVIVRDYEDSEGKDACILTSDSQRDVKVLE--WRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGP 197 (350)
Q Consensus 120 d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~--~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~ 197 (350)
+|.|..||..+ ++.+-...... ...... ..++++.++++..++.+..||...++....+.
T Consensus 2 ~g~l~~~d~~t--G~~~W~~~~~~--~~~~~~~~~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~-------------- 63 (238)
T PF13360_consen 2 DGTLSALDPRT--GKELWSYDLGP--GIGGPVATAVPDGGRVYVASGDGNLYALDAKTGKVLWRFD-------------- 63 (238)
T ss_dssp TSEEEEEETTT--TEEEEEEECSS--SCSSEEETEEEETTEEEEEETTSEEEEEETTTSEEEEEEE--------------
T ss_pred CCEEEEEECCC--CCEEEEEECCC--CCCCccceEEEeCCEEEEEcCCCEEEEEECCCCCEEEEee--------------
Confidence 56777777733 55444432211 122222 33355788888888999999987443321111
Q ss_pred CCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee-eecC----CCeEEEEEcCCCCEEEEE
Q 018806 198 GTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI-RRGF----GGLSILKWSPTGDYFFAA 272 (350)
Q Consensus 198 ~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~----~~v~~~~~sp~g~~l~~~ 272 (350)
+. ..+.... ..++..+++++.+ +.++.+|..+|+.... .... ..........++..++++
T Consensus 64 ---------~~----~~~~~~~-~~~~~~v~v~~~~-~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 128 (238)
T PF13360_consen 64 ---------LP----GPISGAP-VVDGGRVYVGTSD-GSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVG 128 (238)
T ss_dssp ---------CS----SCGGSGE-EEETTEEEEEETT-SEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEE
T ss_pred ---------cc----cccccee-eecccccccccce-eeeEecccCCcceeeeeccccccccccccccCceEecCEEEEE
Confidence 11 1111111 2235566666677 5999999999987665 2221 112223333347888888
Q ss_pred ecCCeEEEEeCCCCcee
Q 018806 273 KFDGTFYLWETNTWTSE 289 (350)
Q Consensus 273 ~~d~~v~iwd~~~~~~~ 289 (350)
..++.|+.+|.++|+..
T Consensus 129 ~~~g~l~~~d~~tG~~~ 145 (238)
T PF13360_consen 129 TSSGKLVALDPKTGKLL 145 (238)
T ss_dssp ETCSEEEEEETTTTEEE
T ss_pred eccCcEEEEecCCCcEE
Confidence 88999999999999883
No 346
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.47 E-value=0.059 Score=48.06 Aligned_cols=205 Identities=15% Similarity=0.089 Sum_probs=103.8
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccc--
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAA-- 187 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~-- 187 (350)
++..++.++.++.+..+|..+ ++..-... ..+.+.+.-.. .+..+++...++.++.||...++..........
T Consensus 104 ~~~~v~v~~~~g~l~ald~~t--G~~~W~~~--~~~~~~~~p~v-~~~~v~v~~~~g~l~a~d~~tG~~~W~~~~~~~~~ 178 (377)
T TIGR03300 104 DGGLVFVGTEKGEVIALDAED--GKELWRAK--LSSEVLSPPLV-ANGLVVVRTNDGRLTALDAATGERLWTYSRVTPAL 178 (377)
T ss_pred cCCEEEEEcCCCEEEEEECCC--CcEeeeec--cCceeecCCEE-ECCEEEEECCCCeEEEEEcCCCceeeEEccCCCce
Confidence 466777888899999998754 55433221 12222221111 235677777789999999875543322211110
Q ss_pred ------ccc---ce-ecCCCCCceEEeeeccCCC--------C---Cc---eeeEEECC--CCCeEEEEEeCCCeEEEEe
Q 018806 188 ------SFL---GA-LSRGPGTRWTLVDFLRSQN--------G---EQ---ITALSWGP--DGRYLASASYESSSFTIWD 241 (350)
Q Consensus 188 ------~~~---~~-~~~~~~~~~~~~~~~~~~~--------~---~~---v~~~~~sp--~g~~l~~~~~d~g~i~iwd 241 (350)
.+. .. +....++.+..++.-.+.. . .. ...+.-+| .+..++.++.+ |.++.||
T Consensus 179 ~~~~~~sp~~~~~~v~~~~~~g~v~ald~~tG~~~W~~~~~~~~g~~~~~~~~~~~~~p~~~~~~vy~~~~~-g~l~a~d 257 (377)
T TIGR03300 179 TLRGSASPVIADGGVLVGFAGGKLVALDLQTGQPLWEQRVALPKGRTELERLVDVDGDPVVDGGQVYAVSYQ-GRVAALD 257 (377)
T ss_pred eecCCCCCEEECCEEEEECCCCEEEEEEccCCCEeeeeccccCCCCCchhhhhccCCccEEECCEEEEEEcC-CEEEEEE
Confidence 000 01 1112223333222211110 0 00 00000111 24567777777 6999999
Q ss_pred CCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc-cC-CCCeEEEEEcCCCCEEEEEECCCeE
Q 018806 242 VAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-ST-SGFVTGATWDPEGRMILLAFAGSLT 319 (350)
Q Consensus 242 ~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-~~-~~~v~~~~~s~~g~~l~~~~~~~~~ 319 (350)
..+++........ ....+. .++..+++++.+|.|+.+|..+++..-.. .. .....+... .+..|++++. +..
T Consensus 258 ~~tG~~~W~~~~~-~~~~p~--~~~~~vyv~~~~G~l~~~d~~tG~~~W~~~~~~~~~~ssp~i--~g~~l~~~~~-~G~ 331 (377)
T TIGR03300 258 LRSGRVLWKRDAS-SYQGPA--VDDNRLYVTDADGVVVALDRRSGSELWKNDELKYRQLTAPAV--VGGYLVVGDF-EGY 331 (377)
T ss_pred CCCCcEEEeeccC-CccCce--EeCCEEEEECCCCeEEEEECCCCcEEEccccccCCccccCEE--ECCEEEEEeC-CCE
Confidence 9998765543321 111222 24667888888999999999998864211 11 112222222 3556665542 235
Q ss_pred EEEEEeC
Q 018806 320 LGSIHFA 326 (350)
Q Consensus 320 ~~~~~~~ 326 (350)
++.++..
T Consensus 332 l~~~d~~ 338 (377)
T TIGR03300 332 LHWLSRE 338 (377)
T ss_pred EEEEECC
Confidence 5555543
No 347
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=97.46 E-value=0.00041 Score=64.69 Aligned_cols=111 Identities=22% Similarity=0.233 Sum_probs=81.3
Q ss_pred ceeeEEECCCCCeEEEEEe---CCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 214 QITALSWGPDGRYLASASY---ESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~---d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
.-+-.+|+|...+++.++. ..|.|.||- ++|++..-....-.+.++||+|..-.|+.|-.-|.+.+|...+.+...
T Consensus 17 vsti~SWHPsePlfAVA~fS~er~GSVtIfa-dtGEPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~e~ht 95 (1416)
T KOG3617|consen 17 VSTISSWHPSEPLFAVASFSPERGGSVTIFA-DTGEPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTTETHT 95 (1416)
T ss_pred cccccccCCCCceeEEEEecCCCCceEEEEe-cCCCCCcccccceehhhhccChHHHHHhhccccceeEEEecCCceeee
Confidence 3455689999999887753 237888884 455544333334456679999998888999999999999998877754
Q ss_pred c-ccCCCCeEEEEEcCCCCEEEEEE-CCCeEEEEEEe
Q 018806 291 W-SSTSGFVTGATWDPEGRMILLAF-AGSLTLGSIHF 325 (350)
Q Consensus 291 ~-~~~~~~v~~~~~s~~g~~l~~~~-~~~~~~~~~~~ 325 (350)
. ..|..+|..+.||++|..|+++. -+...+|..+.
T Consensus 96 v~~th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d~ 132 (1416)
T KOG3617|consen 96 VVETHPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYDV 132 (1416)
T ss_pred eccCCCCCceeEEecCCCCeEEEcCCCceeEEEEeee
Confidence 3 47889999999999999999875 22344444443
No 348
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=97.40 E-value=0.022 Score=40.13 Aligned_cols=66 Identities=12% Similarity=0.056 Sum_probs=49.3
Q ss_pred eeEEEEec---CC-CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 102 LQGVSWHQ---HK-HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 102 V~~v~~sp---~g-~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
|+++++.. || +-|++|+.|..|++|+- ...+..+ .....|.++.-... ++++++..+|+|-+|+-.
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~----~e~~~Ei--~e~~~v~~L~~~~~-~~F~Y~l~NGTVGvY~~~ 71 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKG----DEIVAEI--TETDKVTSLCSLGG-GRFAYALANGTVGVYDRS 71 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeC----CcEEEEE--ecccceEEEEEcCC-CEEEEEecCCEEEEEeCc
Confidence 66777654 33 67889999999999995 2333444 24567888887776 788888889999999764
No 349
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=97.40 E-value=0.0044 Score=53.83 Aligned_cols=163 Identities=13% Similarity=0.131 Sum_probs=102.9
Q ss_pred EEEEE-ECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccc
Q 018806 113 IVAFI-SGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLG 191 (350)
Q Consensus 113 ~la~~-s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~ 191 (350)
.||.+ -.++.+.++|-.. +.........-|..+|..+..++.+..+++....|.|.-|..+. ..++...
T Consensus 113 ~IAVs~~~sg~i~VvD~~~-d~~q~~~fkklH~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e~---~~qfPr~------ 182 (558)
T KOG0882|consen 113 LIAVSLFKSGKIFVVDGFG-DFCQDGYFKKLHFSPVKKIRYNQAGDSAVSIDISGMVEYWSAEG---PFQFPRT------ 182 (558)
T ss_pred eEEeecccCCCcEEECCcC-CcCccceecccccCceEEEEeeccccceeeccccceeEeecCCC---cccCccc------
Confidence 34443 3578899998642 23333444345899999999999987777777789999998872 1111000
Q ss_pred eecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee--------------------
Q 018806 192 ALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-------------------- 251 (350)
Q Consensus 192 ~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-------------------- 251 (350)
.+.+..-..-.+....+. .....++.|+|+|..+.+-+.|. .|++++.++++.....
T Consensus 183 ~l~~~~K~eTdLy~f~K~--Kt~pts~Efsp~g~qistl~~Dr-kVR~F~~KtGklvqeiDE~~t~~~~q~ks~y~l~~V 259 (558)
T KOG0882|consen 183 NLNFELKHETDLYGFPKA--KTEPTSFEFSPDGAQISTLNPDR-KVRGFVFKTGKLVQEIDEVLTDAQYQPKSPYGLMHV 259 (558)
T ss_pred cccccccccchhhccccc--ccCccceEEccccCcccccCccc-EEEEEEeccchhhhhhhccchhhhhcccccccccee
Confidence 000000000011111122 24678999999999999999884 9999999988432111
Q ss_pred -------------ecC-CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee
Q 018806 252 -------------RGF-GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE 289 (350)
Q Consensus 252 -------------~~~-~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~ 289 (350)
.+. ..-..++|...|++|+.++-=| |++.++.++++.
T Consensus 260 elgRRmaverelek~~~~~~~~~~fdes~~flly~t~~g-ikvin~~tn~v~ 310 (558)
T KOG0882|consen 260 ELGRRMAVERELEKHGSTVGTNAVFDESGNFLLYGTILG-IKVINLDTNTVV 310 (558)
T ss_pred ehhhhhhHHhhHhhhcCcccceeEEcCCCCEEEeeccee-EEEEEeecCeEE
Confidence 011 1234577888899998887655 888888887653
No 350
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=97.40 E-value=0.00042 Score=64.93 Aligned_cols=154 Identities=16% Similarity=0.121 Sum_probs=107.4
Q ss_pred CCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 141 SDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 141 ~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
..|....++++|+-+.++++.+...|.|+++++..+..... ...|. +.|+-+.-
T Consensus 1098 rd~~~~fTc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s-------------------------~ncH~-SavT~veP 1151 (1516)
T KOG1832|consen 1098 RDETALFTCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEES-------------------------VNCHQ-SAVTLVEP 1151 (1516)
T ss_pred hccccceeeEEeecCCceEEeeeccceEEEEEccCcccccc-------------------------ccccc-cccccccc
Confidence 46778899999999988888888899999999985543222 44554 78999998
Q ss_pred CCCCCeEEEEEeCCC-eEEEEeCCCC-CceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecc-c----c
Q 018806 221 GPDGRYLASASYESS-SFTIWDVAQG-LGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPW-S----S 293 (350)
Q Consensus 221 sp~g~~l~~~~~d~g-~i~iwd~~~~-~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~-~----~ 293 (350)
+.||..+++.+.-+. -..+|++.+- ..... -..-.++.|+..-++-+.|.......+||++++..... . +
T Consensus 1152 s~dgs~~Ltsss~S~PlsaLW~~~s~~~~~Hs---f~ed~~vkFsn~~q~r~~gt~~d~a~~YDvqT~~~l~tylt~~~~ 1228 (1516)
T KOG1832|consen 1152 SVDGSTQLTSSSSSSPLSALWDASSTGGPRHS---FDEDKAVKFSNSLQFRALGTEADDALLYDVQTCSPLQTYLTDTVT 1228 (1516)
T ss_pred cCCcceeeeeccccCchHHHhccccccCcccc---ccccceeehhhhHHHHHhcccccceEEEecccCcHHHHhcCcchh
Confidence 999988877655432 4678998752 11111 23445677877655556666667789999999876321 1 2
Q ss_pred CCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 294 TSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 294 ~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
....-....|+|+.++++-- +-+|+++...
T Consensus 1229 ~~y~~n~a~FsP~D~LIlnd----GvLWDvR~~~ 1258 (1516)
T KOG1832|consen 1229 SSYSNNLAHFSPCDTLILND----GVLWDVRIPE 1258 (1516)
T ss_pred hhhhccccccCCCcceEeeC----ceeeeeccHH
Confidence 22233667899999988743 5788887654
No 351
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=97.36 E-value=0.065 Score=44.76 Aligned_cols=188 Identities=17% Similarity=0.176 Sum_probs=101.4
Q ss_pred cCeeEEEEecCCCEEEEEE-CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFIS-GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s-~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
..+.+.+++++|+.+|... .++.-.||-... +....... ....+....|++++...++...+...+++.....+.
T Consensus 24 ~~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~--~~~~~~~~--~g~~l~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~ 99 (253)
T PF10647_consen 24 YDVTSPAVSPDGSRVAAVSEGDGGRSLYVGPA--GGPVRPVL--TGGSLTRPSWDPDGWVWTVDDGSGGVRVVRDSASGT 99 (253)
T ss_pred ccccceEECCCCCeEEEEEEcCCCCEEEEEcC--CCcceeec--cCCccccccccCCCCEEEEEcCCCceEEEEecCCCc
Confidence 3689999999999888766 223333444432 22222222 234788999999955554444456666664211111
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC--CCeEEEEeCC---CCCce-----
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYE--SSSFTIWDVA---QGLGT----- 248 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~~---~~~~~----- 248 (350)
...+.. . ..... ..|..+.+||||..++....+ ++.|.+=-+. .+...
T Consensus 100 ~~~~~v--------------------~-~~~~~-~~I~~l~vSpDG~RvA~v~~~~~~~~v~va~V~r~~~g~~~~l~~~ 157 (253)
T PF10647_consen 100 GEPVEV--------------------D-WPGLR-GRITALRVSPDGTRVAVVVEDGGGGRVYVAGVVRDGDGVPRRLTGP 157 (253)
T ss_pred ceeEEe--------------------c-ccccC-CceEEEEECCCCcEEEEEEecCCCCeEEEEEEEeCCCCCcceeccc
Confidence 111100 0 01111 289999999999999887632 2466665433 22111
Q ss_pred -eee-ecCCCeEEEEEcCCCCEEEEEec-CCeEEE-EeCCCCceeccccCCCCeEEEEEcCCCCEEEEE
Q 018806 249 -PIR-RGFGGLSILKWSPTGDYFFAAKF-DGTFYL-WETNTWTSEPWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 249 -~~~-~~~~~v~~~~~sp~g~~l~~~~~-d~~v~i-wd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
.+. .....+..+.|.+++.+++.+.. ++.+.. .....+....+..-...+..++...+...++..
T Consensus 158 ~~~~~~~~~~v~~v~W~~~~~L~V~~~~~~~~~~~~v~~dG~~~~~l~~~~~~~~v~a~~~~~~~~~~t 226 (253)
T PF10647_consen 158 RRVAPPLLSDVTDVAWSDDSTLVVLGRSAGGPVVRLVSVDGGPSTPLPSVNLGVPVVAVAASPSTVYVT 226 (253)
T ss_pred eEecccccCcceeeeecCCCEEEEEeCCCCCceeEEEEccCCcccccCCCCCCcceEEeeCCCcEEEEE
Confidence 111 12357889999999988766654 333433 555554444443222333334444444444444
No 352
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=97.30 E-value=0.0092 Score=53.99 Aligned_cols=114 Identities=22% Similarity=0.331 Sum_probs=74.0
Q ss_pred eeeEEECCCCCeEEEEEeCCC----eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC-----------CeEE
Q 018806 215 ITALSWGPDGRYLASASYESS----SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD-----------GTFY 279 (350)
Q Consensus 215 v~~~~~sp~g~~l~~~~~d~g----~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d-----------~~v~ 279 (350)
+..+.+||+|++++.+-..+| +++++|+.+++...-.-.......+.|.++++.|+....+ ..|+
T Consensus 126 ~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i~~~~~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~~~v~ 205 (414)
T PF02897_consen 126 LGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDGIENPKFSSVSWSDDGKGFFYTRFDEDQRTSDSGYPRQVY 205 (414)
T ss_dssp EEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEEEEEEESEEEEECTTSSEEEEEECSTTTSS-CCGCCEEEE
T ss_pred eeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCcccccccceEEEeCCCCEEEEEEeCcccccccCCCCcEEE
Confidence 346789999999998754434 6999999999654322111122239999999888666432 2478
Q ss_pred EEeCCCCcee--ccc-cCC-CC-eEEEEEcCCCCEEEEEE--CCC-eEEEEEEeCCC
Q 018806 280 LWETNTWTSE--PWS-STS-GF-VTGATWDPEGRMILLAF--AGS-LTLGSIHFASK 328 (350)
Q Consensus 280 iwd~~~~~~~--~~~-~~~-~~-v~~~~~s~~g~~l~~~~--~~~-~~~~~~~~~~~ 328 (350)
.|.+.+.... .+. ... .. ...+..++|+++|++.. ... ..++.++....
T Consensus 206 ~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~~ 262 (414)
T PF02897_consen 206 RHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDDG 262 (414)
T ss_dssp EEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCCT
T ss_pred EEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEecccc
Confidence 8888776542 222 222 22 56889999999988765 333 57888887764
No 353
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=97.27 E-value=0.016 Score=55.56 Aligned_cols=138 Identities=14% Similarity=0.126 Sum_probs=84.3
Q ss_pred CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEee-----CCCeEEEEecCCcEEEEecCCCCCCceeecccccccceec
Q 018806 120 STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRP-----NGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALS 194 (350)
Q Consensus 120 d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp-----~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~ 194 (350)
...++-.|+ ..|+.+..+......+|..++-.. +....+.+-.++.+..||.+..+.. .+...
T Consensus 503 ~~~ly~mDL--e~GKVV~eW~~~~~~~v~~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~k-~v~~~--------- 570 (794)
T PF08553_consen 503 PNKLYKMDL--ERGKVVEEWKVHDDIPVVDIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGNK-LVDSQ--------- 570 (794)
T ss_pred CCceEEEec--CCCcEEEEeecCCCcceeEecccccccccCCCceEEEECCCceEEeccCCCCCc-eeecc---------
Confidence 345555566 457777766543434455443221 1245566777889999999855421 11110
Q ss_pred CCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ecCCCeEEEEEcCCCCEEEEEe
Q 018806 195 RGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RGFGGLSILKWSPTGDYFFAAK 273 (350)
Q Consensus 195 ~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~~~~v~~~~~sp~g~~l~~~~ 273 (350)
...+. ......+++-+.+| +||.|+.+ |.||+||--.......+ +-..+|..+..+.||+||++.+
T Consensus 571 ---------~k~Y~--~~~~Fs~~aTt~~G-~iavgs~~-G~IRLyd~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc 637 (794)
T PF08553_consen 571 ---------SKQYS--SKNNFSCFATTEDG-YIAVGSNK-GDIRLYDRLGKRAKTALPGLGDPIIGIDVTADGKWILATC 637 (794)
T ss_pred ---------ccccc--cCCCceEEEecCCc-eEEEEeCC-CcEEeecccchhhhhcCCCCCCCeeEEEecCCCcEEEEee
Confidence 01111 12456777777776 78888888 89999995432222222 3467899999999999987655
Q ss_pred cCCeEEEEeC
Q 018806 274 FDGTFYLWET 283 (350)
Q Consensus 274 ~d~~v~iwd~ 283 (350)
+..|-+++.
T Consensus 638 -~tyLlLi~t 646 (794)
T PF08553_consen 638 -KTYLLLIDT 646 (794)
T ss_pred -cceEEEEEE
Confidence 466777765
No 354
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=97.26 E-value=0.0022 Score=58.08 Aligned_cols=78 Identities=14% Similarity=0.272 Sum_probs=61.8
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCee-EEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVK-VLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~-~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
....+.-+.|+|.-.+||++..+|.+.+..++ .+.+..+. -++..++ +++|.|||+.++++-.||+|++.|++.+
T Consensus 19 l~~~i~~~ewnP~~dLiA~~t~~gelli~R~n---~qRlwtip-~p~~~v~~sL~W~~DGkllaVg~kdG~I~L~Dve~~ 94 (665)
T KOG4640|consen 19 LPINIKRIEWNPKMDLIATRTEKGELLIHRLN---WQRLWTIP-IPGENVTASLCWRPDGKLLAVGFKDGTIRLHDVEKG 94 (665)
T ss_pred cccceEEEEEcCccchhheeccCCcEEEEEec---cceeEecc-CCCCccceeeeecCCCCEEEEEecCCeEEEEEccCC
Confidence 34578899999999999999999999999885 34344442 2556666 9999999877777777999999999966
Q ss_pred CCC
Q 018806 177 GNA 179 (350)
Q Consensus 177 ~~~ 179 (350)
...
T Consensus 95 ~~l 97 (665)
T KOG4640|consen 95 GRL 97 (665)
T ss_pred Cce
Confidence 544
No 355
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=97.25 E-value=0.12 Score=47.17 Aligned_cols=182 Identities=14% Similarity=0.237 Sum_probs=104.7
Q ss_pred CeeEEEEecCCCEEEEEE---CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC----CCeEEEEecCCcEEEEec
Q 018806 101 DLQGVSWHQHKHIVAFIS---GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN----GGRSLSVGCKGGICIWAP 173 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s---~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~----~~~l~~~~~d~~v~iwd~ 173 (350)
+|..++|. ||+.++-.. .+|.++. |.... + +.-.-|..+.|.|- ...++++-..+.|.||-+
T Consensus 21 PvhGlaWT-DGkqVvLT~L~l~~gE~kf-------Gds~v-i--GqFEhV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL 89 (671)
T PF15390_consen 21 PVHGLAWT-DGKQVVLTDLQLHNGEPKF-------GDSKV-I--GQFEHVHGLSWAPPCTADTPALLAVQHKKHVTVWQL 89 (671)
T ss_pred cccceEec-CCCEEEEEeeeeeCCcccc-------CCccE-e--eccceeeeeeecCcccCCCCceEEEeccceEEEEEe
Confidence 48889998 676555422 1232222 11111 1 22235899999885 347899999999999998
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCC--CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce--e
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN--GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT--P 249 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~--~ 249 (350)
...... .++|.+.++..... .--...+.|+|....|+.-+..+ .=.+++++..... .
T Consensus 90 ~~s~~e------------------~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~d-vSV~~sV~~d~srVka 150 (671)
T PF15390_consen 90 CPSTTE------------------RNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARD-VSVLPSVHCDSSRVKA 150 (671)
T ss_pred ccCccc------------------cccceeeeeeeccCCcccCCCcccccCCCceEEEEecCc-eeEeeeeeeCCceEEE
Confidence 722111 11222222222211 11234688999988888777664 4455666543322 2
Q ss_pred eeecCCCeEEEEEcCCCCEEEEEecC-CeEEEEeCCCCcee-----ccccCCCCeEEEEEcCCCCEEEEE
Q 018806 250 IRRGFGGLSILKWSPTGDYFFAAKFD-GTFYLWETNTWTSE-----PWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 250 ~~~~~~~v~~~~~sp~g~~l~~~~~d-~~v~iwd~~~~~~~-----~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
-....+-|.|.||.+||+.|+++-.. =.-+|||-...... ..+.-.+.|.+|.-.-| ..+|++
T Consensus 151 Di~~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~~qKtL~~CsfcPVFdv~~~Icsi~AT~d-sqVAva 219 (671)
T PF15390_consen 151 DIKTSGLIHCACWTKDGQRLVVAVGSSLHSYIWDSAQKTLHRCSFCPVFDVGGYICSIEATVD-SQVAVA 219 (671)
T ss_pred eccCCceEEEEEecCcCCEEEEEeCCeEEEEEecCchhhhhhCCcceeecCCCceEEEEEecc-ceEEEE
Confidence 23456889999999999998766433 25678886554432 23344556666554443 334444
No 356
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.24 E-value=0.09 Score=49.82 Aligned_cols=153 Identities=12% Similarity=0.147 Sum_probs=91.4
Q ss_pred CEEEEEECCC-----eEEEEEccCCCCCc--eeE----e-c--CC-CCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCC
Q 018806 112 HIVAFISGST-----QVIVRDYEDSEGKD--ACI----L-T--SD-SQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYP 176 (350)
Q Consensus 112 ~~la~~s~d~-----~i~iw~~~~~~~~~--~~~----~-~--~~-~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~ 176 (350)
.+|++.+.|+ .++||+++.-++.. .+. + . .+ ...++.+++.+.+-+.++++-.+|.|..+.-+.-
T Consensus 78 ~~L~sv~Ed~~~np~llkiw~lek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~ 157 (933)
T KOG2114|consen 78 NFLFSVGEDEQGNPVLLKIWDLEKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYKGDIL 157 (933)
T ss_pred eEEEEEeecCCCCceEEEEecccccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEcCcch
Confidence 5777766543 58999997542222 111 1 1 11 3567889999988555655556799888754311
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-ee-eeecC
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TP-IRRGF 254 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~-~~~~~ 254 (350)
..... +......+ ..+|+.+++..+++.++.+..-+ .|.+|.+....+ .. +-.+.
T Consensus 158 RDrgs--------------------r~~~~~~~--~~pITgL~~~~d~~s~lFv~Tt~-~V~~y~l~gr~p~~~~ld~~G 214 (933)
T KOG2114|consen 158 RDRGS--------------------RQDYSHRG--KEPITGLALRSDGKSVLFVATTE-QVMLYSLSGRTPSLKVLDNNG 214 (933)
T ss_pred hcccc--------------------ceeeeccC--CCCceeeEEecCCceeEEEEecc-eeEEEEecCCCcceeeeccCC
Confidence 11000 00111122 36999999999988844444443 799999985442 22 22344
Q ss_pred CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 255 GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 255 ~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
..+.|..|++....+++++ +..+++|+.+..+.
T Consensus 215 ~~lnCss~~~~t~qfIca~-~e~l~fY~sd~~~~ 247 (933)
T KOG2114|consen 215 ISLNCSSFSDGTYQFICAG-SEFLYFYDSDGRGP 247 (933)
T ss_pred ccceeeecCCCCccEEEec-CceEEEEcCCCcce
Confidence 5677888887655455554 45699999875444
No 357
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.11 E-value=0.0017 Score=35.50 Aligned_cols=32 Identities=34% Similarity=0.695 Sum_probs=28.6
Q ss_pred eecCCCeEEEEEcCCCCEEEEEecCCeEEEEe
Q 018806 251 RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWE 282 (350)
Q Consensus 251 ~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd 282 (350)
..+...+.+++|+++++++++++.|+.+++|+
T Consensus 9 ~~~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 9 KGHTGPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred EecCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 35667899999999999999999999999996
No 358
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=97.07 E-value=0.082 Score=46.94 Aligned_cols=153 Identities=15% Similarity=0.183 Sum_probs=82.5
Q ss_pred CeeEEEEecCCCEEEEEE-----------CCC-eEEEEEccCCCCCce-eEecCCCCCCeeEEEEeeCCCeEEEEecCCc
Q 018806 101 DLQGVSWHQHKHIVAFIS-----------GST-QVIVRDYEDSEGKDA-CILTSDSQRDVKVLEWRPNGGRSLSVGCKGG 167 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s-----------~d~-~i~iw~~~~~~~~~~-~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~ 167 (350)
...+|+|.++|+++++-. ..+ .|.+++-...+++.. .......-.....+++.++| ++++.....
T Consensus 15 ~P~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa~~l~~p~Gi~~~~~G--lyV~~~~~i 92 (367)
T TIGR02604 15 NPIAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFAEELSMVTGLAVAVGG--VYVATPPDI 92 (367)
T ss_pred CCceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEeecCCCCccceeEecCC--EEEeCCCeE
Confidence 367899999999877642 122 566665433334322 12222223456889999886 444433332
Q ss_pred EEEEecCCCCCCc-eeecccccccceecCCCCCceEEeeeccCC---CCCceeeEEECCCCCeEEEEEeC----------
Q 018806 168 ICIWAPSYPGNAA-SVRSGAASFLGALSRGPGTRWTLVDFLRSQ---NGEQITALSWGPDGRYLASASYE---------- 233 (350)
Q Consensus 168 v~iwd~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~---~~~~v~~~~~sp~g~~l~~~~~d---------- 233 (350)
.++.|........ .. -.+...+... .......++|.|||...++.+..
T Consensus 93 ~~~~d~~gdg~ad~~~------------------~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~~~ 154 (367)
T TIGR02604 93 LFLRDKDGDDKADGER------------------EVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASKVTRPGT 154 (367)
T ss_pred EEEeCCCCCCCCCCcc------------------EEEEEccCCCCCcccccccCceECCCCCEEEecccCCCceeccCCC
Confidence 3333544222111 00 0011112111 11357789999999776654421
Q ss_pred --------CCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe
Q 018806 234 --------SSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK 273 (350)
Q Consensus 234 --------~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~ 273 (350)
.|.|..++..+++...+.........++|+++|+++++-.
T Consensus 155 ~~~~~~~~~g~i~r~~pdg~~~e~~a~G~rnp~Gl~~d~~G~l~~tdn 202 (367)
T TIGR02604 155 SDESRQGLGGGLFRYNPDGGKLRVVAHGFQNPYGHSVDSWGDVFFCDN 202 (367)
T ss_pred ccCcccccCceEEEEecCCCeEEEEecCcCCCccceECCCCCEEEEcc
Confidence 1356666666555444444445567899999998876644
No 359
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=97.07 E-value=0.024 Score=50.69 Aligned_cols=108 Identities=14% Similarity=0.152 Sum_probs=72.1
Q ss_pred eeeEEECCCCCe-------EEEEEeCCCeEEEEeCCCCCc--e-eeeec----CCCeEEEEEcCCCCEEEEEecCCeEEE
Q 018806 215 ITALSWGPDGRY-------LASASYESSSFTIWDVAQGLG--T-PIRRG----FGGLSILKWSPTGDYFFAAKFDGTFYL 280 (350)
Q Consensus 215 v~~~~~sp~g~~-------l~~~~~d~g~i~iwd~~~~~~--~-~~~~~----~~~v~~~~~sp~g~~l~~~~~d~~v~i 280 (350)
|.-+.+.|+.+. -+.|-.++ .|.-||.+-... . ....+ .....|.+-..+| +|++|+.+|.|++
T Consensus 378 i~mv~~t~d~K~~Ql~~e~TlvGLs~n-~vfriDpRv~~~~kl~~~q~kqy~~k~nFsc~aTT~sG-~IvvgS~~GdIRL 455 (644)
T KOG2395|consen 378 INMVDITPDFKFAQLTSEQTLVGLSDN-SVFRIDPRVQGKNKLAVVQSKQYSTKNNFSCFATTESG-YIVVGSLKGDIRL 455 (644)
T ss_pred cceeeccCCcchhcccccccEEeecCC-ceEEecccccCcceeeeeeccccccccccceeeecCCc-eEEEeecCCcEEe
Confidence 555566665431 12233453 899999885432 1 12222 2345566655566 7999999999999
Q ss_pred EeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 281 WETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 281 wd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
||- .+.. ..+.+...+|..+.-+.||++|+.+|..-..+.+..+
T Consensus 456 Ydr-i~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc~tyLlLi~t~~ 501 (644)
T KOG2395|consen 456 YDR-IGRRAKTALPGLGDAIKHVDVTADGKWILATCKTYLLLIDTLI 501 (644)
T ss_pred ehh-hhhhhhhcccccCCceeeEEeeccCcEEEEecccEEEEEEEec
Confidence 997 4433 3467888999999999999999988876656666555
No 360
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=97.02 E-value=0.18 Score=44.93 Aligned_cols=89 Identities=8% Similarity=0.019 Sum_probs=46.5
Q ss_pred eEEEEeCCCCCceeeeecCC--CeEEEEEc-----CCCCEEEEEecCCeEEEEeCCCCceec-cc----cCCCCeEEEEE
Q 018806 236 SFTIWDVAQGLGTPIRRGFG--GLSILKWS-----PTGDYFFAAKFDGTFYLWETNTWTSEP-WS----STSGFVTGATW 303 (350)
Q Consensus 236 ~i~iwd~~~~~~~~~~~~~~--~v~~~~~s-----p~g~~l~~~~~d~~v~iwd~~~~~~~~-~~----~~~~~v~~~~~ 303 (350)
.++++...+.+...... +. ....+++- ..+..|++-..+|.+++|.+..-+... .. .....+....+
T Consensus 236 ~irv~~~~~~k~~~K~~-~~~~~~~~~~vv~~~~~~~~~~Lv~l~~~G~i~i~SLP~Lkei~~~~l~~~~d~~~~~~ssi 314 (395)
T PF08596_consen 236 DIRVFKPPKSKGAHKSF-DDPFLCSSASVVPTISRNGGYCLVCLFNNGSIRIYSLPSLKEIKSVSLPPPLDSRRLSSSSI 314 (395)
T ss_dssp EEEEE-TT---EEEEE--SS-EEEEEEEEEEEE-EEEEEEEEEEETTSEEEEEETTT--EEEEEE-SS---HHHHTT-EE
T ss_pred ceEEEeCCCCcccceee-ccccccceEEEEeecccCCceEEEEEECCCcEEEEECCCchHhhcccCCCccccccccccEE
Confidence 78888877665543222 22 22334452 245667888899999999998877632 11 12223456778
Q ss_pred cCCCCEEEEEECCCeEEEEEEeCC
Q 018806 304 DPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 304 s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
+++|..++..+.. .+..+.+|.
T Consensus 315 s~~Gdi~~~~gps--E~~l~sv~~ 336 (395)
T PF08596_consen 315 SRNGDIFYWTGPS--EIQLFSVWG 336 (395)
T ss_dssp -TTS-EEEE-SSS--EEEEEEEES
T ss_pred CCCCCEEEEeCcc--cEEEEEEEc
Confidence 9999988776543 344444443
No 361
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=96.98 E-value=0.16 Score=42.04 Aligned_cols=144 Identities=13% Similarity=0.146 Sum_probs=89.4
Q ss_pred CeeEEEEeeCCCeEEEEecC-C-cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC
Q 018806 146 DVKVLEWRPNGGRSLSVGCK-G-GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD 223 (350)
Q Consensus 146 ~v~~~~~sp~~~~l~~~~~d-~-~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~ 223 (350)
....++|+|...+-++.... | ...++|......+..+...+ -+-+.+| =.||||
T Consensus 69 R~Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~-----------------~RHfyGH-------Gvfs~d 124 (366)
T COG3490 69 RGHGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQE-----------------GRHFYGH-------GVFSPD 124 (366)
T ss_pred ccCCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEeccc-----------------Cceeecc-------cccCCC
Confidence 34457788875555555553 4 45688887555554433321 1123344 379999
Q ss_pred CCeEEEEEeC----CCeEEEEeCCCCCce--eeeecCCCeEEEEEcCCCCEEEEEecC------------------CeEE
Q 018806 224 GRYLASASYE----SSSFTIWDVAQGLGT--PIRRGFGGLSILKWSPTGDYFFAAKFD------------------GTFY 279 (350)
Q Consensus 224 g~~l~~~~~d----~g~i~iwd~~~~~~~--~~~~~~~~v~~~~~sp~g~~l~~~~~d------------------~~v~ 279 (350)
|++|+..-+| .|.|-+||.+.+-.. .+..|.-....+.|.+||+.++.+... -++.
T Consensus 125 G~~LYATEndfd~~rGViGvYd~r~~fqrvgE~~t~GiGpHev~lm~DGrtlvvanGGIethpdfgR~~lNldsMePSlv 204 (366)
T COG3490 125 GRLLYATENDFDPNRGVIGVYDAREGFQRVGEFSTHGIGPHEVTLMADGRTLVVANGGIETHPDFGRTELNLDSMEPSLV 204 (366)
T ss_pred CcEEEeecCCCCCCCceEEEEecccccceecccccCCcCcceeEEecCCcEEEEeCCceecccccCccccchhhcCccEE
Confidence 9999876433 278999999855322 233344556789999999998766421 1345
Q ss_pred EEeCCCCcee---ccc--cCCCCeEEEEEcCCCCEEEEE
Q 018806 280 LWETNTWTSE---PWS--STSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 280 iwd~~~~~~~---~~~--~~~~~v~~~~~s~~g~~l~~~ 313 (350)
+.|..+|+.. .+. .+.-.+..++..+||+.++.+
T Consensus 205 lld~atG~liekh~Lp~~l~~lSiRHld~g~dgtvwfgc 243 (366)
T COG3490 205 LLDAATGNLIEKHTLPASLRQLSIRHLDIGRDGTVWFGC 243 (366)
T ss_pred EEeccccchhhhccCchhhhhcceeeeeeCCCCcEEEEE
Confidence 5565566552 222 345678899999999877644
No 362
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=96.89 E-value=0.18 Score=41.20 Aligned_cols=71 Identities=14% Similarity=0.058 Sum_probs=45.9
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCee-EEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeec
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVK-VLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRS 184 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~-~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~ 184 (350)
-|++++.|...|.+++.++++ +.....+... +.|. .....++++.+..++.|++.+..|....+...+...
T Consensus 62 vgdfVV~GCy~g~lYfl~~~t--Gs~~w~f~~~--~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~cVykskc 133 (354)
T KOG4649|consen 62 VGDFVVLGCYSGGLYFLCVKT--GSQIWNFVIL--ETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSKC 133 (354)
T ss_pred ECCEEEEEEccCcEEEEEecc--hhheeeeeeh--hhhccceEEcCCCceEEEecCCCcEEEecccccceEEeccc
Confidence 567899999999999988854 5433333211 2222 223456767777777799999999886665554433
No 363
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=96.88 E-value=0.085 Score=37.21 Aligned_cols=100 Identities=14% Similarity=0.075 Sum_probs=61.8
Q ss_pred eeEEEEee---CC-CeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC
Q 018806 147 VKVLEWRP---NG-GRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP 222 (350)
Q Consensus 147 v~~~~~sp---~~-~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 222 (350)
|+++++.. +| ..|++++.|..|++|+-+. +...+... ..|+++.-..
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~~e---------------------------~~~Ei~e~--~~v~~L~~~~ 52 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFEIRVFKGDE---------------------------IVAEITET--DKVTSLCSLG 52 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcEEEEEeCCc---------------------------EEEEEecc--cceEEEEEcC
Confidence 55666643 33 3577777789999998651 12222222 4778887766
Q ss_pred CCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEc-C--CCC-EEEEEecCCeEE
Q 018806 223 DGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWS-P--TGD-YFFAAKFDGTFY 279 (350)
Q Consensus 223 ~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~s-p--~g~-~l~~~~~d~~v~ 279 (350)
. ..++++..+ |+|-+|+-... ......+..+.++++. . ||. .|++|-.+|.|-
T Consensus 53 ~-~~F~Y~l~N-GTVGvY~~~~R--lWRiKSK~~~~~~~~~D~~gdG~~eLI~GwsnGkve 109 (111)
T PF14783_consen 53 G-GRFAYALAN-GTVGVYDRSQR--LWRIKSKNQVTSMAFYDINGDGVPELIVGWSNGKVE 109 (111)
T ss_pred C-CEEEEEecC-CEEEEEeCcce--eeeeccCCCeEEEEEEcCCCCCceEEEEEecCCeEE
Confidence 5 568888777 89999986432 2223334445555543 3 332 578888888764
No 364
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=96.84 E-value=0.24 Score=41.91 Aligned_cols=161 Identities=13% Similarity=0.063 Sum_probs=88.4
Q ss_pred CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccc
Q 018806 110 HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASF 189 (350)
Q Consensus 110 ~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~ 189 (350)
.++.|+.|..+| +.+++... ........ +...|..+...|+-+ ++..-.|+.++++++..-.............
T Consensus 6 ~~~~L~vGt~~G-l~~~~~~~--~~~~~~i~--~~~~I~ql~vl~~~~-~llvLsd~~l~~~~L~~l~~~~~~~~~~~~~ 79 (275)
T PF00780_consen 6 WGDRLLVGTEDG-LYVYDLSD--PSKPTRIL--KLSSITQLSVLPELN-LLLVLSDGQLYVYDLDSLEPVSTSAPLAFPK 79 (275)
T ss_pred CCCEEEEEECCC-EEEEEecC--CccceeEe--ecceEEEEEEecccC-EEEEEcCCccEEEEchhhccccccccccccc
Confidence 578899999988 88888832 22223222 334499999999844 4445566999999987332221100000000
Q ss_pred cceecCCCCCceEEeeeccCCCCCceeeEE--ECCCCCeEEEEEeCCCeEEEEeCCCC--C---ceeeeecCCCeEEEEE
Q 018806 190 LGALSRGPGTRWTLVDFLRSQNGEQITALS--WGPDGRYLASASYESSSFTIWDVAQG--L---GTPIRRGFGGLSILKW 262 (350)
Q Consensus 190 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~--~sp~g~~l~~~~~d~g~i~iwd~~~~--~---~~~~~~~~~~v~~~~~ 262 (350)
... ....+.. ...+..++ -...+...++....+ +|.+|..... . ...-..-...+..++|
T Consensus 80 --------~~~--~~~~~~~--~~~v~~f~~~~~~~~~~~L~va~kk-~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~ 146 (275)
T PF00780_consen 80 --------SRS--LPTKLPE--TKGVSFFAVNGGHEGSRRLCVAVKK-KILIYEWNDPRNSFSKLLKEISLPDPPSSIAF 146 (275)
T ss_pred --------ccc--ccccccc--cCCeeEEeeccccccceEEEEEECC-EEEEEEEECCcccccceeEEEEcCCCcEEEEE
Confidence 000 0000110 12334343 112333344444453 8888877653 2 2222334578889999
Q ss_pred cCCCCEEEEEecCCeEEEEeCCCCceeccc
Q 018806 263 SPTGDYFFAAKFDGTFYLWETNTWTSEPWS 292 (350)
Q Consensus 263 sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~ 292 (350)
. ++.|+.|.. +...+.|+.++....+.
T Consensus 147 ~--~~~i~v~~~-~~f~~idl~~~~~~~l~ 173 (275)
T PF00780_consen 147 L--GNKICVGTS-KGFYLIDLNTGSPSELL 173 (275)
T ss_pred e--CCEEEEEeC-CceEEEecCCCCceEEe
Confidence 8 556777764 45889999987765443
No 365
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=96.83 E-value=0.0042 Score=33.86 Aligned_cols=34 Identities=38% Similarity=0.847 Sum_probs=28.5
Q ss_pred eccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEe
Q 018806 206 FLRSQNGEQITALSWGPDGRYLASASYESSSFTIWD 241 (350)
Q Consensus 206 ~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd 241 (350)
.+..|. ..+.++.|+++++.+++++.+ |.+++|+
T Consensus 7 ~~~~~~-~~i~~~~~~~~~~~~~~~~~d-~~~~~~~ 40 (40)
T smart00320 7 TLKGHT-GPVTSVAFSPDGKYLASASDD-GTIKLWD 40 (40)
T ss_pred EEEecC-CceeEEEECCCCCEEEEecCC-CeEEEcC
Confidence 344554 689999999999999999999 6999996
No 366
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=96.83 E-value=0.1 Score=43.24 Aligned_cols=160 Identities=18% Similarity=0.226 Sum_probs=91.5
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecC-CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCK-GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d-~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
+-...+..++|+|+.+.|+++... +.|..++.. +..... -.+.+. +..-.+++
T Consensus 19 g~~~e~SGLTy~pd~~tLfaV~d~~~~i~els~~-G~vlr~-----------------------i~l~g~--~D~EgI~y 72 (248)
T PF06977_consen 19 GILDELSGLTYNPDTGTLFAVQDEPGEIYELSLD-GKVLRR-----------------------IPLDGF--GDYEGITY 72 (248)
T ss_dssp T--S-EEEEEEETTTTEEEEEETTTTEEEEEETT---EEEE-----------------------EE-SS---SSEEEEEE
T ss_pred CccCCccccEEcCCCCeEEEEECCCCEEEEEcCC-CCEEEE-----------------------EeCCCC--CCceeEEE
Confidence 344569999999998888888775 777666653 221111 113332 57888999
Q ss_pred CCCCCeEEEEEeCCCeEEEEeCCCCC----ce---eee-----ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC--C
Q 018806 221 GPDGRYLASASYESSSFTIWDVAQGL----GT---PIR-----RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNT--W 286 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iwd~~~~~----~~---~~~-----~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~--~ 286 (350)
..++.++++.-.+ +.+.++++.... .. .+. .++.++-.++|+|.++.|+++-+..-..+|.++. .
T Consensus 73 ~g~~~~vl~~Er~-~~L~~~~~~~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~ 151 (248)
T PF06977_consen 73 LGNGRYVLSEERD-QRLYIFTIDDDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPG 151 (248)
T ss_dssp -STTEEEEEETTT-TEEEEEEE----TT--EEEEEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-
T ss_pred ECCCEEEEEEcCC-CcEEEEEEeccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccC
Confidence 8877666655445 699999884321 11 111 1345689999999988887777776666666653 1
Q ss_pred -cee------ccc---cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 287 -TSE------PWS---STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 287 -~~~------~~~---~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
... .+. .....+.+++++|....|++-++.+..+..++...+
T Consensus 152 ~~~~~~~~~~~~~~~~~~~~d~S~l~~~p~t~~lliLS~es~~l~~~d~~G~ 203 (248)
T PF06977_consen 152 GFDLFVSDDQDLDDDKLFVRDLSGLSYDPRTGHLLILSDESRLLLELDRQGR 203 (248)
T ss_dssp SS--EEEE-HHHH-HT--SS---EEEEETTTTEEEEEETTTTEEEEE-TT--
T ss_pred ccceeeccccccccccceeccccceEEcCCCCeEEEEECCCCeEEEECCCCC
Confidence 110 111 233457899999987777777777777777775544
No 367
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=96.82 E-value=0.24 Score=43.09 Aligned_cols=110 Identities=15% Similarity=0.055 Sum_probs=65.2
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-ceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC--Ccee
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGL-GTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNT--WTSE 289 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~-~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~--~~~~ 289 (350)
+.|++++-- +++ |+++... .|.+|++...+ ..........+...+....+.+|++|...+.+.++.++. .+..
T Consensus 89 g~V~ai~~~-~~~-lv~~~g~--~l~v~~l~~~~~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv~~~~~~~~~~~l~ 164 (321)
T PF03178_consen 89 GPVTAICSF-NGR-LVVAVGN--KLYVYDLDNSKTLLKKAFYDSPFYITSLSVFKNYILVGDAMKSVSLLRYDEENNKLI 164 (321)
T ss_dssp S-EEEEEEE-TTE-EEEEETT--EEEEEEEETTSSEEEEEEE-BSSSEEEEEEETTEEEEEESSSSEEEEEEETTTE-EE
T ss_pred CcceEhhhh-CCE-EEEeecC--EEEEEEccCcccchhhheecceEEEEEEeccccEEEEEEcccCEEEEEEEccCCEEE
Confidence 678888765 344 5555443 89999999887 444433333333333344466999998888888775543 3232
Q ss_pred ccc--cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 290 PWS--STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 290 ~~~--~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
.+. .....++++.|-++++.++ ++|....++.++...
T Consensus 165 ~va~d~~~~~v~~~~~l~d~~~~i-~~D~~gnl~~l~~~~ 203 (321)
T PF03178_consen 165 LVARDYQPRWVTAAEFLVDEDTII-VGDKDGNLFVLRYNP 203 (321)
T ss_dssp EEEEESS-BEEEEEEEE-SSSEEE-EEETTSEEEEEEE-S
T ss_pred EEEecCCCccEEEEEEecCCcEEE-EEcCCCeEEEEEECC
Confidence 222 2345688899987777554 555556677776653
No 368
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=96.82 E-value=0.074 Score=49.77 Aligned_cols=99 Identities=19% Similarity=0.257 Sum_probs=66.2
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee--eecCCCeEEEEEc--CCCCEEEEEecCCeEEEEeCCC----
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI--RRGFGGLSILKWS--PTGDYFFAAKFDGTFYLWETNT---- 285 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~--~~~~~~v~~~~~s--p~g~~l~~~~~d~~v~iwd~~~---- 285 (350)
.+.-+.-|.-++.-++-+.. -++.|||.+.+....- +...+.|..+.|. |+|+.+++.+..+.|.+|-...
T Consensus 31 ~~~li~gss~~k~a~V~~~~-~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~ 109 (631)
T PF12234_consen 31 NPSLISGSSIKKIAVVDSSR-SELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYT 109 (631)
T ss_pred CcceEeecccCcEEEEECCC-CEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhh
Confidence 44555555544444443334 4999999998875432 2346889999986 6899998888999999985421
Q ss_pred -Cce-------eccccCC-CCeEEEEEcCCCCEEEEE
Q 018806 286 -WTS-------EPWSSTS-GFVTGATWDPEGRMILLA 313 (350)
Q Consensus 286 -~~~-------~~~~~~~-~~v~~~~~s~~g~~l~~~ 313 (350)
... ..+..+. .+|.+..|.++|..++.+
T Consensus 110 ~~~p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~s 146 (631)
T PF12234_consen 110 NKGPSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGS 146 (631)
T ss_pred cCCcccceeEEEEeecCCCCCccceeEecCCeEEEEe
Confidence 111 1122333 689999999999877644
No 369
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=96.79 E-value=0.24 Score=41.27 Aligned_cols=195 Identities=11% Similarity=0.148 Sum_probs=115.2
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
..|.++.|+|+.+.|.+..+...-.|+-- .+|+.+..+.-..-...-.+.+.-+|+..++--.++.+.++.+......
T Consensus 86 ~nvS~LTynp~~rtLFav~n~p~~iVElt--~~GdlirtiPL~g~~DpE~Ieyig~n~fvi~dER~~~l~~~~vd~~t~~ 163 (316)
T COG3204 86 ANVSSLTYNPDTRTLFAVTNKPAAIVELT--KEGDLIRTIPLTGFSDPETIEYIGGNQFVIVDERDRALYLFTVDADTTV 163 (316)
T ss_pred ccccceeeCCCcceEEEecCCCceEEEEe--cCCceEEEecccccCChhHeEEecCCEEEEEehhcceEEEEEEcCCccE
Confidence 35999999999999988777766555543 3477666664433344566788777443333333688888887744322
Q ss_pred ceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC-ce--eeee-c--
Q 018806 180 ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL-GT--PIRR-G-- 253 (350)
Q Consensus 180 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~-~~--~~~~-~-- 253 (350)
..+... ++. ....... +.....++|+|..+.|..+-..+ -+.||.+.... .. .... +
T Consensus 164 ~~~~~~--------------~i~-L~~~~k~-N~GfEGlA~d~~~~~l~~aKEr~-P~~I~~~~~~~~~l~~~~~~~~~~ 226 (316)
T COG3204 164 ISAKVQ--------------KIP-LGTTNKK-NKGFEGLAWDPVDHRLFVAKERN-PIGIFEVTQSPSSLSVHASLDPTA 226 (316)
T ss_pred Eeccce--------------EEe-ccccCCC-CcCceeeecCCCCceEEEEEccC-CcEEEEEecCCcccccccccCccc
Confidence 221110 000 1111121 35778999999988888887764 77777665432 11 1111 1
Q ss_pred -----CCCeEEEEEcCC-CCEEEEEecCCeEEEEeCCCCceec--cc-------cCCCCeEEEEEcCCCCEEEEE
Q 018806 254 -----FGGLSILKWSPT-GDYFFAAKFDGTFYLWETNTWTSEP--WS-------STSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 254 -----~~~v~~~~~sp~-g~~l~~~~~d~~v~iwd~~~~~~~~--~~-------~~~~~v~~~~~s~~g~~l~~~ 313 (350)
-..+.++.|++. +..++.+.+++.+--.|....-... +. ..-...-.++...+|..-+++
T Consensus 227 ~~~~f~~DvSgl~~~~~~~~LLVLS~ESr~l~Evd~~G~~~~~lsL~~g~~gL~~dipqaEGiamDd~g~lYIvS 301 (316)
T COG3204 227 DRDLFVLDVSGLEFNAITNSLLVLSDESRRLLEVDLSGEVIELLSLTKGNHGLSSDIPQAEGIAMDDDGNLYIVS 301 (316)
T ss_pred ccceEeeccccceecCCCCcEEEEecCCceEEEEecCCCeeeeEEeccCCCCCcccCCCcceeEECCCCCEEEEe
Confidence 134677888874 5566777778877777776543221 11 111234567788877766555
No 370
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.78 E-value=0.0047 Score=36.25 Aligned_cols=29 Identities=17% Similarity=0.356 Sum_probs=27.3
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEcc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYE 129 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~ 129 (350)
.|.+++|+|...+||.++.+|.|.++.++
T Consensus 13 ~v~~~~w~P~mdLiA~~t~~g~v~v~Rl~ 41 (47)
T PF12894_consen 13 RVSCMSWCPTMDLIALGTEDGEVLVYRLN 41 (47)
T ss_pred cEEEEEECCCCCEEEEEECCCeEEEEECC
Confidence 59999999999999999999999999984
No 371
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=96.71 E-value=0.36 Score=42.02 Aligned_cols=144 Identities=18% Similarity=0.175 Sum_probs=85.0
Q ss_pred CCEEEEEEC----------CCeEEEEEccCC-C--CCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCC
Q 018806 111 KHIVAFISG----------STQVIVRDYEDS-E--GKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPG 177 (350)
Q Consensus 111 g~~la~~s~----------d~~i~iw~~~~~-~--~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~ 177 (350)
..+|+.|.. .|.+.++++... . .+..........++|++++-- + ++ ++++..+.+++|++....
T Consensus 42 ~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~~~~~~g~V~ai~~~-~-~~-lv~~~g~~l~v~~l~~~~ 118 (321)
T PF03178_consen 42 KEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIHSTEVKGPVTAICSF-N-GR-LVVAVGNKLYVYDLDNSK 118 (321)
T ss_dssp SEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEEEEEESS-EEEEEEE-T-TE-EEEEETTEEEEEEEETTS
T ss_pred cCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEEEEeecCcceEhhhh-C-CE-EEEeecCEEEEEEccCcc
Confidence 467887753 288999998642 0 121222222457889998866 3 45 555666899999998544
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC--CCceeeee--c
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ--GLGTPIRR--G 253 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~--~~~~~~~~--~ 253 (350)
.... ...+..+ ..+.++... +.+++.+...+ .+.++..+. .+...+.. .
T Consensus 119 ~l~~----------------------~~~~~~~--~~i~sl~~~--~~~I~vgD~~~-sv~~~~~~~~~~~l~~va~d~~ 171 (321)
T PF03178_consen 119 TLLK----------------------KAFYDSP--FYITSLSVF--KNYILVGDAMK-SVSLLRYDEENNKLILVARDYQ 171 (321)
T ss_dssp SEEE----------------------EEEE-BS--SSEEEEEEE--TTEEEEEESSS-SEEEEEEETTTE-EEEEEEESS
T ss_pred cchh----------------------hheecce--EEEEEEecc--ccEEEEEEccc-CEEEEEEEccCCEEEEEEecCC
Confidence 1111 1112221 355555554 55888887764 666664433 22333332 2
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~ 284 (350)
...+.++.|-++++.++++..+|.+.++...
T Consensus 172 ~~~v~~~~~l~d~~~~i~~D~~gnl~~l~~~ 202 (321)
T PF03178_consen 172 PRWVTAAEFLVDEDTIIVGDKDGNLFVLRYN 202 (321)
T ss_dssp -BEEEEEEEE-SSSEEEEEETTSEEEEEEE-
T ss_pred CccEEEEEEecCCcEEEEEcCCCeEEEEEEC
Confidence 3558888888777788999999999999876
No 372
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=96.59 E-value=0.16 Score=41.44 Aligned_cols=86 Identities=15% Similarity=0.244 Sum_probs=61.6
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeE-EEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccCCCCeEEE
Q 018806 224 GRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLS-ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSSTSGFVTGA 301 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~-~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~~v~~~ 301 (350)
|.+++.+... |.+++.+.++|.....+...+.|. .....+++..+.+++.|++.+..|.++..... .+-..+...+.
T Consensus 63 gdfVV~GCy~-g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~cVykskcgG~~f~sP 141 (354)
T KOG4649|consen 63 GDFVVLGCYS-GGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSKCGGGTFVSP 141 (354)
T ss_pred CCEEEEEEcc-CcEEEEEecchhheeeeeehhhhccceEEcCCCceEEEecCCCcEEEecccccceEEecccCCceeccc
Confidence 6778889888 799999999997665554444443 45567899999999999999999999887743 33233334455
Q ss_pred EEcC-CCCEE
Q 018806 302 TWDP-EGRMI 310 (350)
Q Consensus 302 ~~s~-~g~~l 310 (350)
+..| ++...
T Consensus 142 ~i~~g~~sly 151 (354)
T KOG4649|consen 142 VIAPGDGSLY 151 (354)
T ss_pred eecCCCceEE
Confidence 6666 44433
No 373
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=96.49 E-value=0.15 Score=46.54 Aligned_cols=115 Identities=20% Similarity=0.221 Sum_probs=76.3
Q ss_pred CceeeEEECCC----CCeEEEEEeCCCeEEEEeCCCC-----Ccee-eeec---CCC--eEEEEEcCCCCEEEEEecCCe
Q 018806 213 EQITALSWGPD----GRYLASASYESSSFTIWDVAQG-----LGTP-IRRG---FGG--LSILKWSPTGDYFFAAKFDGT 277 (350)
Q Consensus 213 ~~v~~~~~sp~----g~~l~~~~~d~g~i~iwd~~~~-----~~~~-~~~~---~~~--v~~~~~sp~g~~l~~~~~d~~ 277 (350)
+.|..+.|.|- -..|++.-..+ .|.+|.+... +... ...+ .-+ ...+.|+|....|++-.....
T Consensus 57 EhV~GlsW~P~~~~~~paLLAVQHkk-hVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT~~dv 135 (671)
T PF15390_consen 57 EHVHGLSWAPPCTADTPALLAVQHKK-HVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLTARDV 135 (671)
T ss_pred ceeeeeeecCcccCCCCceEEEeccc-eEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEecCce
Confidence 57899999984 32455555563 9999987622 1111 1111 112 346889999998876665554
Q ss_pred EEEEeCCCCce--eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCC
Q 018806 278 FYLWETNTWTS--EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFASK 328 (350)
Q Consensus 278 v~iwd~~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~ 328 (350)
--+++++.... +.-....+.|.+.+|.+||+.|+++-+....-|.|+-.++
T Consensus 136 SV~~sV~~d~srVkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~~qK 188 (671)
T PF15390_consen 136 SVLPSVHCDSSRVKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYIWDSAQK 188 (671)
T ss_pred eEeeeeeeCCceEEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEEecCchh
Confidence 44566654333 2223567889999999999999999888888888876654
No 374
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=96.47 E-value=0.015 Score=34.15 Aligned_cols=31 Identities=26% Similarity=0.445 Sum_probs=28.2
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~ 284 (350)
...|..++|+|...+||.+..+|.|.+|.+.
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl~ 41 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGEVLVYRLN 41 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCeEEEEECC
Confidence 3568899999999999999999999999983
No 375
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=96.39 E-value=0.25 Score=40.95 Aligned_cols=103 Identities=15% Similarity=0.115 Sum_probs=70.1
Q ss_pred CceeeEEECCCC-CeEEEEEeCCCeEEEEeCCCCCceeeeec-C--CCeEEEEEcCCCCEEEEEec-----CCeEEEEeC
Q 018806 213 EQITALSWGPDG-RYLASASYESSSFTIWDVAQGLGTPIRRG-F--GGLSILKWSPTGDYFFAAKF-----DGTFYLWET 283 (350)
Q Consensus 213 ~~v~~~~~sp~g-~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~--~~v~~~~~sp~g~~l~~~~~-----d~~v~iwd~ 283 (350)
.....++|+|.- +-++.+-.-.-...++|....+...+... + ...-.=+|||||.+|...-. .|.|-|||.
T Consensus 68 aR~Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~~RHfyGHGvfs~dG~~LYATEndfd~~rGViGvYd~ 147 (366)
T COG3490 68 ARGHGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQEGRHFYGHGVFSPDGRLLYATENDFDPNRGVIGVYDA 147 (366)
T ss_pred cccCCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEecccCceeecccccCCCCcEEEeecCCCCCCCceEEEEec
Confidence 345668888864 44556655522467888887765443321 1 22334579999999976543 368999999
Q ss_pred CCCce--eccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 284 NTWTS--EPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 284 ~~~~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
+.+-. -.+..|.-....+.|.+||+.|+++.+
T Consensus 148 r~~fqrvgE~~t~GiGpHev~lm~DGrtlvvanG 181 (366)
T COG3490 148 REGFQRVGEFSTHGIGPHEVTLMADGRTLVVANG 181 (366)
T ss_pred ccccceecccccCCcCcceeEEecCCcEEEEeCC
Confidence 86543 356677777789999999999998754
No 376
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=96.38 E-value=0.26 Score=43.74 Aligned_cols=97 Identities=15% Similarity=0.177 Sum_probs=57.6
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEE-eCCCC-----Cceeeee--------cCCCeEEEEEcCCCCEEEEEec-----
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIW-DVAQG-----LGTPIRR--------GFGGLSILKWSPTGDYFFAAKF----- 274 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iw-d~~~~-----~~~~~~~--------~~~~v~~~~~sp~g~~l~~~~~----- 274 (350)
....+++.++| |+++... .|..| |.... +...+.. +......++|.|||.+.++.+.
T Consensus 73 ~p~Gi~~~~~G--lyV~~~~--~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gpDG~LYv~~G~~~~~~ 148 (367)
T TIGR02604 73 MVTGLAVAVGG--VYVATPP--DILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGPDGWLYFNHGNTLASK 148 (367)
T ss_pred CccceeEecCC--EEEeCCC--eEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECCCCCEEEecccCCCce
Confidence 56789999988 4444444 45544 54321 2222221 1234678999999987654431
Q ss_pred --------------CCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 275 --------------DGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 275 --------------d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.+.|.-++.++++...+.........++|+++|+++++-.
T Consensus 149 ~~~~~~~~~~~~~~~g~i~r~~pdg~~~e~~a~G~rnp~Gl~~d~~G~l~~tdn 202 (367)
T TIGR02604 149 VTRPGTSDESRQGLGGGLFRYNPDGGKLRVVAHGFQNPYGHSVDSWGDVFFCDN 202 (367)
T ss_pred eccCCCccCcccccCceEEEEecCCCeEEEEecCcCCCccceECCCCCEEEEcc
Confidence 1456666666665544433334457899999998876543
No 377
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=96.38 E-value=0.33 Score=43.63 Aligned_cols=64 Identities=11% Similarity=0.036 Sum_probs=43.6
Q ss_pred CCCeEEEEEeCCCeEEEEeCCCCCceeeeec--CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCcee
Q 018806 223 DGRYLASASYESSSFTIWDVAQGLGTPIRRG--FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSE 289 (350)
Q Consensus 223 ~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~--~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~ 289 (350)
.+..++.++.+ |.+..+|..+++....... .....+... .+..|+.++.+|.|+++|..+|+..
T Consensus 293 ~~~~vy~~~~~-g~l~ald~~tG~~~W~~~~~~~~~~~sp~v--~~g~l~v~~~~G~l~~ld~~tG~~~ 358 (394)
T PRK11138 293 DGGRIYLVDQN-DRVYALDTRGGVELWSQSDLLHRLLTAPVL--YNGYLVVGDSEGYLHWINREDGRFV 358 (394)
T ss_pred ECCEEEEEcCC-CeEEEEECCCCcEEEcccccCCCcccCCEE--ECCEEEEEeCCCEEEEEECCCCCEE
Confidence 45677777777 6999999998876442221 111222222 2457788899999999999999874
No 378
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=96.36 E-value=0.57 Score=40.25 Aligned_cols=180 Identities=16% Similarity=0.209 Sum_probs=96.5
Q ss_pred EEEecCCCEEEEEE-CCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceee
Q 018806 105 VSWHQHKHIVAFIS-GSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVR 183 (350)
Q Consensus 105 v~~sp~g~~la~~s-~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~ 183 (350)
..|.++...|+.+. ..+.|.-|+... +.. ..+ .+.+.+.++..-..+..|+++.. .+.+++.+.......+.
T Consensus 30 P~w~~~~~~L~w~DI~~~~i~r~~~~~--g~~-~~~--~~p~~~~~~~~~d~~g~Lv~~~~--g~~~~~~~~~~~~t~~~ 102 (307)
T COG3386 30 PVWDPDRGALLWVDILGGRIHRLDPET--GKK-RVF--PSPGGFSSGALIDAGGRLIACEH--GVRLLDPDTGGKITLLA 102 (307)
T ss_pred ccCcCCCCEEEEEeCCCCeEEEecCCc--Cce-EEE--ECCCCcccceeecCCCeEEEEcc--ccEEEeccCCceeEEec
Confidence 34667777555544 567777777642 332 222 23445566665555455554433 34556654232211111
Q ss_pred cccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEe-----C-----CCeEEEEeCCCCCceeeeec
Q 018806 184 SGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASY-----E-----SSSFTIWDVAQGLGTPIRRG 253 (350)
Q Consensus 184 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-----d-----~g~i~iwd~~~~~~~~~~~~ 253 (350)
....+......+.....|+|.+.+.... . .|.++.+|. .+....+...
T Consensus 103 ---------------------~~~~~~~~~r~ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~~ 160 (307)
T COG3386 103 ---------------------EPEDGLPLNRPNDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLDD 160 (307)
T ss_pred ---------------------cccCCCCcCCCCceeEcCCCCEEEeCCCccccCccccCCcceEEEEcC-CCCEEEeecC
Confidence 1112222345677888888887765544 1 144555554 3444444433
Q ss_pred -CCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCC--Cce---e---ccccCCCCeEEEEEcCCCCEEEEE
Q 018806 254 -FGGLSILKWSPTGDYFFAAKF-DGTFYLWETNT--WTS---E---PWSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 254 -~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~--~~~---~---~~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
-.....++||||++.|..+.. .+.|+-|++.. +.. . .+....+..-.++...+|.+-+.+
T Consensus 161 ~~~~~NGla~SpDg~tly~aDT~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDadG~lw~~a 230 (307)
T COG3386 161 DLTIPNGLAFSPDGKTLYVADTPANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDADGNLWVAA 230 (307)
T ss_pred cEEecCceEECCCCCEEEEEeCCCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeCCCCEEEec
Confidence 455678999999998877754 57888888763 221 1 111223444556666666665433
No 379
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.33 E-value=0.018 Score=55.63 Aligned_cols=102 Identities=14% Similarity=0.149 Sum_probs=69.6
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCceeee--ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec-cccCCCCeE-
Q 018806 224 GRYLASASYESSSFTIWDVAQGLGTPIR--RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP-WSSTSGFVT- 299 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~~~~~--~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~~v~- 299 (350)
+-.++.++.. |.+-..|+...-..... ...++|.+++|+.+|+.++.|-.+|.|.+||+..++..+ +..+..+.+
T Consensus 99 ~~~ivi~Ts~-ghvl~~d~~~nL~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i~e~~ap~t~ 177 (1206)
T KOG2079|consen 99 VVPIVIGTSH-GHVLLSDMTGNLGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVITEHGAPVTG 177 (1206)
T ss_pred eeeEEEEcCc-hhhhhhhhhcccchhhcCCccCCcceeeEecCCCceeccccCCCcEEEEEccCCcceeeeeecCCccce
Confidence 4467777666 78988888764221112 235889999999999999999999999999999988744 334444433
Q ss_pred --EEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 300 --GATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 300 --~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
.+.+..++..++ +++..+.+|..-+..
T Consensus 178 vi~v~~t~~nS~ll-t~D~~Gsf~~lv~nk 206 (1206)
T KOG2079|consen 178 VIFVGRTSQNSKLL-TSDTGGSFWKLVFNK 206 (1206)
T ss_pred EEEEEEeCCCcEEE-EccCCCceEEEEech
Confidence 344455555454 445555677776654
No 380
>COG3204 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=96.21 E-value=0.6 Score=39.05 Aligned_cols=162 Identities=14% Similarity=0.175 Sum_probs=101.2
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG 221 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s 221 (350)
+....+.++.|+|+.+.|++......-.|+=...+.....+ .+.+- .....+.+.
T Consensus 83 g~~~nvS~LTynp~~rtLFav~n~p~~iVElt~~Gdlirti-----------------------PL~g~--~DpE~Ieyi 137 (316)
T COG3204 83 GETANVSSLTYNPDTRTLFAVTNKPAAIVELTKEGDLIRTI-----------------------PLTGF--SDPETIEYI 137 (316)
T ss_pred cccccccceeeCCCcceEEEecCCCceEEEEecCCceEEEe-----------------------ccccc--CChhHeEEe
Confidence 34456999999999888888777655444433322222111 12222 345677887
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCce--------eee--ec-CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-e
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLGT--------PIR--RG-FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-E 289 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~~--------~~~--~~-~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~ 289 (350)
.+|++.++--.+ +.+.++.+...... .+. .+ +.+.-.++|.|..+.|..+-+.+-+.||.+..... .
T Consensus 138 g~n~fvi~dER~-~~l~~~~vd~~t~~~~~~~~~i~L~~~~k~N~GfEGlA~d~~~~~l~~aKEr~P~~I~~~~~~~~~l 216 (316)
T COG3204 138 GGNQFVIVDERD-RALYLFTVDADTTVISAKVQKIPLGTTNKKNKGFEGLAWDPVDHRLFVAKERNPIGIFEVTQSPSSL 216 (316)
T ss_pred cCCEEEEEehhc-ceEEEEEEcCCccEEeccceEEeccccCCCCcCceeeecCCCCceEEEEEccCCcEEEEEecCCccc
Confidence 777777776666 58888776654211 111 12 45678999999999999888888777776654331 1
Q ss_pred c---cccC-------CCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCC
Q 018806 290 P---WSST-------SGFVTGATWDPEGRMILLAFAGSLTLGSIHFASKP 329 (350)
Q Consensus 290 ~---~~~~-------~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~ 329 (350)
. ...+ -.-+.++.|.+....|++=++.+..+-+++....+
T Consensus 217 ~~~~~~~~~~~~~~f~~DvSgl~~~~~~~~LLVLS~ESr~l~Evd~~G~~ 266 (316)
T COG3204 217 SVHASLDPTADRDLFVLDVSGLEFNAITNSLLVLSDESRRLLEVDLSGEV 266 (316)
T ss_pred ccccccCcccccceEeeccccceecCCCCcEEEEecCCceEEEEecCCCe
Confidence 1 1111 23467888988777777666666677777776553
No 381
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=96.18 E-value=0.17 Score=47.54 Aligned_cols=118 Identities=17% Similarity=0.286 Sum_probs=71.6
Q ss_pred EEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEe--eCCCeEEEEecCCcEEEEecCCCCCCcee
Q 018806 105 VSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWR--PNGGRSLSVGCKGGICIWAPSYPGNAASV 182 (350)
Q Consensus 105 v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~s--p~~~~l~~~~~d~~v~iwd~~~~~~~~~~ 182 (350)
+.-|.-++..++-+....+.|||... +...........+.|.++.|. |+|+.++++|..+.|.++.-.........
T Consensus 35 i~gss~~k~a~V~~~~~~LtIWD~~~--~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~~~ 112 (631)
T PF12234_consen 35 ISGSSIKKIAVVDSSRSELTIWDTRS--GVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTNKG 112 (631)
T ss_pred EeecccCcEEEEECCCCEEEEEEcCC--cEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhcCC
Confidence 33444444444444556789999853 332222222457889999995 78899999999999999865311111100
Q ss_pred ecccccccceecCCCCCceEEeee--ccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCC
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDF--LRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~ 243 (350)
..|..++. +..++..+|.+..|-++|..++.+ ++ .+.++|-.
T Consensus 113 ----------------p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~s--GN-qlfv~dk~ 156 (631)
T PF12234_consen 113 ----------------PSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGS--GN-QLFVFDKW 156 (631)
T ss_pred ----------------cccceeEEEEeecCCCCCccceeEecCCeEEEEe--CC-EEEEECCC
Confidence 01222221 234444578999999999776654 32 78888743
No 382
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=96.10 E-value=0.66 Score=38.50 Aligned_cols=190 Identities=13% Similarity=0.096 Sum_probs=112.2
Q ss_pred eeEEEEecCCCEEEEEECCC--eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCC
Q 018806 102 LQGVSWHQHKHIVAFISGST--QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGN 178 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~--~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~ 178 (350)
...+.|..+|.++-+.+.-| .|+.+|+. +++..........----.+.... ..+.--.. ++...+||...-+.
T Consensus 47 TQGL~~~~~g~LyESTG~yG~S~l~~~d~~--tg~~~~~~~l~~~~FgEGit~~~--d~l~qLTWk~~~~f~yd~~tl~~ 122 (264)
T PF05096_consen 47 TQGLEFLDDGTLYESTGLYGQSSLRKVDLE--TGKVLQSVPLPPRYFGEGITILG--DKLYQLTWKEGTGFVYDPNTLKK 122 (264)
T ss_dssp EEEEEEEETTEEEEEECSTTEEEEEEEETT--TSSEEEEEE-TTT--EEEEEEET--TEEEEEESSSSEEEEEETTTTEE
T ss_pred CccEEecCCCEEEEeCCCCCcEEEEEEECC--CCcEEEEEECCccccceeEEEEC--CEEEEEEecCCeEEEEccccceE
Confidence 56677877888888877766 56666764 46544444323333333444443 45655555 58889999873222
Q ss_pred CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee---eecC-
Q 018806 179 AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI---RRGF- 254 (350)
Q Consensus 179 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~---~~~~- 254 (350)
...+.-. +.=+.++ .||+.|+.+...+ .++++|..+.+.... ....
T Consensus 123 -------------------------~~~~~y~--~EGWGLt--~dg~~Li~SDGS~-~L~~~dP~~f~~~~~i~V~~~g~ 172 (264)
T PF05096_consen 123 -------------------------IGTFPYP--GEGWGLT--SDGKRLIMSDGSS-RLYFLDPETFKEVRTIQVTDNGR 172 (264)
T ss_dssp -------------------------EEEEE-S--SS--EEE--ECSSCEEEE-SSS-EEEEE-TTT-SEEEEEE-EETTE
T ss_pred -------------------------EEEEecC--CcceEEE--cCCCEEEEECCcc-ceEEECCcccceEEEEEEEECCE
Confidence 2222221 2335555 5677887776664 999999887654432 2222
Q ss_pred --CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc----------------cCCCCeEEEEEcCCCCEEEEEECC
Q 018806 255 --GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS----------------STSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 255 --~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~----------------~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
..+..+.|- +|...|-.-....|...|..+|++.... ........|||.|....|.+++..
T Consensus 173 pv~~LNELE~i-~G~IyANVW~td~I~~Idp~tG~V~~~iDls~L~~~~~~~~~~~~~~dVLNGIAyd~~~~~l~vTGK~ 251 (264)
T PF05096_consen 173 PVSNLNELEYI-NGKIYANVWQTDRIVRIDPETGKVVGWIDLSGLRPEVGRDKSRQPDDDVLNGIAYDPETDRLFVTGKL 251 (264)
T ss_dssp E---EEEEEEE-TTEEEEEETTSSEEEEEETTT-BEEEEEE-HHHHHHHTSTTST--TTS-EEEEEEETTTTEEEEEETT
T ss_pred ECCCcEeEEEE-cCEEEEEeCCCCeEEEEeCCCCeEEEEEEhhHhhhcccccccccccCCeeEeEeEeCCCCEEEEEeCC
Confidence 345667775 7776677767778889999999874311 113467899999988888877644
Q ss_pred CeEEEEEEeC
Q 018806 317 SLTLGSIHFA 326 (350)
Q Consensus 317 ~~~~~~~~~~ 326 (350)
=-.++.+++.
T Consensus 252 Wp~lyeV~l~ 261 (264)
T PF05096_consen 252 WPKLYEVKLV 261 (264)
T ss_dssp -SEEEEEEEE
T ss_pred CCceEEEEEE
Confidence 4577777764
No 383
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=96.03 E-value=0.64 Score=39.32 Aligned_cols=138 Identities=17% Similarity=0.128 Sum_probs=79.2
Q ss_pred CCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCC
Q 018806 155 NGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYES 234 (350)
Q Consensus 155 ~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~ 234 (350)
.+++++.+..+| +.+++.........+.. ...|..+..-|+-+.+++-+ |
T Consensus 6 ~~~~L~vGt~~G-l~~~~~~~~~~~~~i~~---------------------------~~~I~ql~vl~~~~~llvLs-d- 55 (275)
T PF00780_consen 6 WGDRLLVGTEDG-LYVYDLSDPSKPTRILK---------------------------LSSITQLSVLPELNLLLVLS-D- 55 (275)
T ss_pred CCCEEEEEECCC-EEEEEecCCccceeEee---------------------------cceEEEEEEecccCEEEEEc-C-
Confidence 346677775566 89998832222222111 13588999988777766654 4
Q ss_pred CeEEEEeCCCCCcee---------------eeecCCCeEEEE--EcCCCCEEEEEecCCeEEEEeCCCC-----ceeccc
Q 018806 235 SSFTIWDVAQGLGTP---------------IRRGFGGLSILK--WSPTGDYFFAAKFDGTFYLWETNTW-----TSEPWS 292 (350)
Q Consensus 235 g~i~iwd~~~~~~~~---------------~~~~~~~v~~~~--~sp~g~~l~~~~~d~~v~iwd~~~~-----~~~~~~ 292 (350)
|.++++++..-.... .......+...+ =...+...++....+.|.+|..... +...-.
T Consensus 56 ~~l~~~~L~~l~~~~~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~kk~i~i~~~~~~~~~f~~~~ke~ 135 (275)
T PF00780_consen 56 GQLYVYDLDSLEPVSTSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVAVKKKILIYEWNDPRNSFSKLLKEI 135 (275)
T ss_pred CccEEEEchhhccccccccccccccccccccccccCCeeEEeeccccccceEEEEEECCEEEEEEEECCcccccceeEEE
Confidence 599999987653322 111223444444 1123334444445668888877653 222223
Q ss_pred cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEE
Q 018806 293 STSGFVTGATWDPEGRMILLAFAGSLTLGSIH 324 (350)
Q Consensus 293 ~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~ 324 (350)
.....+..++|. ++.|+++..+.-.+.++.
T Consensus 136 ~lp~~~~~i~~~--~~~i~v~~~~~f~~idl~ 165 (275)
T PF00780_consen 136 SLPDPPSSIAFL--GNKICVGTSKGFYLIDLN 165 (275)
T ss_pred EcCCCcEEEEEe--CCEEEEEeCCceEEEecC
Confidence 445788999999 667777765554444433
No 384
>PRK10115 protease 2; Provisional
Probab=96.00 E-value=1.7 Score=42.23 Aligned_cols=194 Identities=12% Similarity=0.067 Sum_probs=98.2
Q ss_pred CeeEEEEecCCCEEEEEEC-----CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC------CcEE
Q 018806 101 DLQGVSWHQHKHIVAFISG-----STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK------GGIC 169 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~-----d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d------~~v~ 169 (350)
.+..+.|||||++||.+.. ...+++.|+.+ +..+.... ...-..++|++|++.++++..+ ..|+
T Consensus 128 ~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~t--g~~l~~~i---~~~~~~~~w~~D~~~~~y~~~~~~~~~~~~v~ 202 (686)
T PRK10115 128 TLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLET--GNWYPELL---DNVEPSFVWANDSWTFYYVRKHPVTLLPYQVW 202 (686)
T ss_pred EEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCC--CCCCCccc---cCcceEEEEeeCCCEEEEEEecCCCCCCCEEE
Confidence 5788899999999998643 23566777743 43222111 1112569999998888887653 2455
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCcee-eEEECCCCCeEEEEEeC--CCeEEEEeCC--C
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQIT-ALSWGPDGRYLASASYE--SSSFTIWDVA--Q 244 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~-~~~~sp~g~~l~~~~~d--~g~i~iwd~~--~ 244 (350)
.+++.++.....+ .+... +.... .+..+.++++++..+.. ++.+.+++.. .
T Consensus 203 ~h~lgt~~~~d~l-----------------------v~~e~-~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~~~~~ 258 (686)
T PRK10115 203 RHTIGTPASQDEL-----------------------VYEEK-DDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDAELAD 258 (686)
T ss_pred EEECCCChhHCeE-----------------------EEeeC-CCCEEEEEEEcCCCCEEEEEEECCccccEEEEECcCCC
Confidence 6666543211110 01111 11222 33345578876654432 1378888853 3
Q ss_pred CCceeeeecC-CCeEEEEEcCCCCEEEEEecC---CeEEEEeCC-CCceeccccC-C-CCeEEEEEcCCCCEEEEEE--C
Q 018806 245 GLGTPIRRGF-GGLSILKWSPTGDYFFAAKFD---GTFYLWETN-TWTSEPWSST-S-GFVTGATWDPEGRMILLAF--A 315 (350)
Q Consensus 245 ~~~~~~~~~~-~~v~~~~~sp~g~~l~~~~~d---~~v~iwd~~-~~~~~~~~~~-~-~~v~~~~~s~~g~~l~~~~--~ 315 (350)
+....+.... +....+. +..+.+.+....+ ..|...++. .++...+..+ . ..+..+.+. ++.|+... +
T Consensus 259 ~~~~~~~~~~~~~~~~~~-~~~~~ly~~tn~~~~~~~l~~~~~~~~~~~~~l~~~~~~~~i~~~~~~--~~~l~~~~~~~ 335 (686)
T PRK10115 259 AEPFVFLPRRKDHEYSLD-HYQHRFYLRSNRHGKNFGLYRTRVRDEQQWEELIPPRENIMLEGFTLF--TDWLVVEERQR 335 (686)
T ss_pred CCceEEEECCCCCEEEEE-eCCCEEEEEEcCCCCCceEEEecCCCcccCeEEECCCCCCEEEEEEEE--CCEEEEEEEeC
Confidence 3333333333 2222222 3233333333222 234444554 2333444444 2 367778877 34554443 4
Q ss_pred CCeEEEEEEeC
Q 018806 316 GSLTLGSIHFA 326 (350)
Q Consensus 316 ~~~~~~~~~~~ 326 (350)
+...++.++.+
T Consensus 336 g~~~l~~~~~~ 346 (686)
T PRK10115 336 GLTSLRQINRK 346 (686)
T ss_pred CEEEEEEEcCC
Confidence 55666666654
No 385
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=95.91 E-value=0.71 Score=41.47 Aligned_cols=136 Identities=15% Similarity=0.070 Sum_probs=77.4
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeeccccccc
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFL 190 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~ 190 (350)
+..++.++.++.+..+|..+ ++..-... .. ....+. ..++.+++++.++.+..+|...+...
T Consensus 256 ~~~vy~~~~~g~l~ald~~t--G~~~W~~~--~~-~~~~~~--~~~~~vy~~~~~g~l~ald~~tG~~~----------- 317 (394)
T PRK11138 256 GGVVYALAYNGNLVALDLRS--GQIVWKRE--YG-SVNDFA--VDGGRIYLVDQNDRVYALDTRGGVEL----------- 317 (394)
T ss_pred CCEEEEEEcCCeEEEEECCC--CCEEEeec--CC-CccCcE--EECCEEEEEcCCCeEEEEECCCCcEE-----------
Confidence 44566677888888888754 54332221 11 111222 24567888888899999988743321
Q ss_pred ceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec-CCCeE-EEEEcCCCCE
Q 018806 191 GALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG-FGGLS-ILKWSPTGDY 268 (350)
Q Consensus 191 ~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~~~v~-~~~~sp~g~~ 268 (350)
|..-... .....+... .+..|+.++.+ |.+...|..+|+....... ...+. ...+ .+..
T Consensus 318 -------------W~~~~~~-~~~~~sp~v--~~g~l~v~~~~-G~l~~ld~~tG~~~~~~~~~~~~~~s~P~~--~~~~ 378 (394)
T PRK11138 318 -------------WSQSDLL-HRLLTAPVL--YNGYLVVGDSE-GYLHWINREDGRFVAQQKVDSSGFLSEPVV--ADDK 378 (394)
T ss_pred -------------EcccccC-CCcccCCEE--ECCEEEEEeCC-CEEEEEECCCCCEEEEEEcCCCcceeCCEE--ECCE
Confidence 1100000 011122222 24567777778 7999999999986654332 22232 2222 2447
Q ss_pred EEEEecCCeEEEEeC
Q 018806 269 FFAAKFDGTFYLWET 283 (350)
Q Consensus 269 l~~~~~d~~v~iwd~ 283 (350)
|++++.||.|+.++.
T Consensus 379 l~v~t~~G~l~~~~~ 393 (394)
T PRK11138 379 LLIQARDGTVYAITR 393 (394)
T ss_pred EEEEeCCceEEEEeC
Confidence 888899999988764
No 386
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=95.79 E-value=0.023 Score=45.23 Aligned_cols=139 Identities=12% Similarity=0.108 Sum_probs=75.0
Q ss_pred EEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecC
Q 018806 116 FISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSR 195 (350)
Q Consensus 116 ~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~ 195 (350)
..+.++.++-+++.. -+..+....-+...-.-+.+ +..+++++.+|.|++|+....+........
T Consensus 35 ~~sa~~~v~~~~~~k--~k~s~rse~~~~e~~~v~~~---~~~~~vG~~dg~v~~~n~n~~g~~~d~~~s---------- 99 (238)
T KOG2444|consen 35 ATSADGLVRERKVRK--HKESCRSERFIDEGQRVVTA---SAKLMVGTSDGAVYVFNWNLEGAHSDRVCS---------- 99 (238)
T ss_pred cccCCcccccchhhh--hhhhhhhhhhhhcceeeccc---CceEEeecccceEEEecCCccchHHHhhhc----------
Confidence 346777777777632 11111111112222222223 356778888999999988743332211111
Q ss_pred CCCCceEEeeeccCCCCCceee-EEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec-C-CCeEEEEEcCCCCEEEEE
Q 018806 196 GPGTRWTLVDFLRSQNGEQITA-LSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG-F-GGLSILKWSPTGDYFFAA 272 (350)
Q Consensus 196 ~~~~~~~~~~~~~~~~~~~v~~-~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~-~-~~v~~~~~sp~g~~l~~~ 272 (350)
. ...|.+ +.--.++.+..++..+ |.|+.|++.-.+..-...+ . ..+..+..+..+++++.+
T Consensus 100 --------------~-~e~i~~~Ip~~~~~~~~c~~~~d-g~ir~~n~~p~k~~g~~g~h~~~~~e~~ivv~sd~~i~~a 163 (238)
T KOG2444|consen 100 --------------G-EESIDLGIPNGRDSSLGCVGAQD-GRIRACNIKPNKVLGYVGQHNFESGEELIVVGSDEFLKIA 163 (238)
T ss_pred --------------c-cccceeccccccccceeEEeccC-CceeeeccccCceeeeeccccCCCcceeEEecCCceEEee
Confidence 0 122222 2222344456666777 7999999988776655543 3 344444555556666666
Q ss_pred --ecCCeEEEEeCCC
Q 018806 273 --KFDGTFYLWETNT 285 (350)
Q Consensus 273 --~~d~~v~iwd~~~ 285 (350)
+.|..++.|++..
T Consensus 164 ~~S~d~~~k~W~ve~ 178 (238)
T KOG2444|consen 164 DTSHDRVLKKWNVEK 178 (238)
T ss_pred ccccchhhhhcchhh
Confidence 6677777777754
No 387
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=95.73 E-value=1.3 Score=38.82 Aligned_cols=52 Identities=13% Similarity=0.233 Sum_probs=33.4
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCC-CceeEe---cCCCCCCeeEEEEeeC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEG-KDACIL---TSDSQRDVKVLEWRPN 155 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~-~~~~~~---~~~~~~~v~~~~~sp~ 155 (350)
.++|+|.|||+++++ ...|.|++++.+ ... ..+... ..........++++|+
T Consensus 4 P~~~a~~pdG~l~v~-e~~G~i~~~~~~-g~~~~~v~~~~~v~~~~~~gllgia~~p~ 59 (331)
T PF07995_consen 4 PRSMAFLPDGRLLVA-ERSGRIWVVDKD-GSLKTPVADLPEVFADGERGLLGIAFHPD 59 (331)
T ss_dssp EEEEEEETTSCEEEE-ETTTEEEEEETT-TEECEEEEE-TTTBTSTTBSEEEEEE-TT
T ss_pred ceEEEEeCCCcEEEE-eCCceEEEEeCC-CcCcceecccccccccccCCcccceeccc
Confidence 578999999987765 679999999832 221 111111 1234567899999994
No 388
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=95.70 E-value=0.64 Score=41.56 Aligned_cols=136 Identities=12% Similarity=0.082 Sum_probs=76.5
Q ss_pred CeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc-eeeccc-------------ccccceecCCCC----CceEEeeec
Q 018806 146 DVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA-SVRSGA-------------ASFLGALSRGPG----TRWTLVDFL 207 (350)
Q Consensus 146 ~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~-~~~~~~-------------~~~~~~~~~~~~----~~~~~~~~~ 207 (350)
.|+.+.|+++...++++...|.|-||.....+.-. .-.... ......+..... ..+.....+
T Consensus 3 ~v~~vs~a~~t~Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~l~ 82 (395)
T PF08596_consen 3 SVTHVSFAPETLELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLTLL 82 (395)
T ss_dssp -EEEEEEETTTTEEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEEEE
T ss_pred eEEEEEecCCCceEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchhhe
Confidence 58899999998888888888999999887432221 000000 001111111111 122333334
Q ss_pred cCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee---e------cCCCeEEEEEcC-----CC---CEEE
Q 018806 208 RSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR---R------GFGGLSILKWSP-----TG---DYFF 270 (350)
Q Consensus 208 ~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~---~------~~~~v~~~~~sp-----~g---~~l~ 270 (350)
... .+.|++++.|. =-+++.+..+ |.+.|.|++........ . ....+.++.|+. |+ -.++
T Consensus 83 ~~~-~g~vtal~~S~-iGFvaigy~~-G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L~ 159 (395)
T PF08596_consen 83 DAK-QGPVTALKNSD-IGFVAIGYES-GSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICLL 159 (395)
T ss_dssp ----S-SEEEEEE-B-TSEEEEEETT-SEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEEE
T ss_pred ecc-CCcEeEEecCC-CcEEEEEecC-CcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEEE
Confidence 444 37999999974 4478888877 89999999877544321 1 123577788862 33 3578
Q ss_pred EEecCCeEEEEeCC
Q 018806 271 AAKFDGTFYLWETN 284 (350)
Q Consensus 271 ~~~~d~~v~iwd~~ 284 (350)
+|...|.+.+|.+-
T Consensus 160 vGTn~G~v~~fkIl 173 (395)
T PF08596_consen 160 VGTNSGNVLTFKIL 173 (395)
T ss_dssp EEETTSEEEEEEEE
T ss_pred EEeCCCCEEEEEEe
Confidence 88889999999774
No 389
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=95.60 E-value=0.68 Score=40.66 Aligned_cols=171 Identities=11% Similarity=0.088 Sum_probs=88.2
Q ss_pred CCCCceeEecCCC----CCCeeEEEEeeCCCeEEEEec-C--CcEEEEecCCCCCCceeecccccccceecCCCCCceEE
Q 018806 131 SEGKDACILTSDS----QRDVKVLEWRPNGGRSLSVGC-K--GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTL 203 (350)
Q Consensus 131 ~~~~~~~~~~~~~----~~~v~~~~~sp~~~~l~~~~~-d--~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 203 (350)
.+|..+.+++..+ .--.+.=+|.++|++|+.++. + ..+++.|+... ...++
T Consensus 18 ~TG~~VtrLT~~~~~~h~~YF~~~~ft~dG~kllF~s~~dg~~nly~lDL~t~-~i~QL--------------------- 75 (386)
T PF14583_consen 18 DTGHRVTRLTPPDGHSHRLYFYQNCFTDDGRKLLFASDFDGNRNLYLLDLATG-EITQL--------------------- 75 (386)
T ss_dssp TT--EEEE-S-TTS-EE---TTS--B-TTS-EEEEEE-TTSS-EEEEEETTT--EEEE----------------------
T ss_pred CCCceEEEecCCCCcccceeecCCCcCCCCCEEEEEeccCCCcceEEEEcccC-EEEEC---------------------
Confidence 3455555554321 122334467899988888776 5 44555566522 22221
Q ss_pred eeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecC-CCeEEEEE--cCCCCEEEEEec------
Q 018806 204 VDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGF-GGLSILKW--SPTGDYFFAAKF------ 274 (350)
Q Consensus 204 ~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~-~~v~~~~~--sp~g~~l~~~~~------ 274 (350)
............++|+++.++..-... .++-.|+++.+...+..-. ..+....| +.|+..++..-.
T Consensus 76 ----Tdg~g~~~~g~~~s~~~~~~~Yv~~~~-~l~~vdL~T~e~~~vy~~p~~~~g~gt~v~n~d~t~~~g~e~~~~d~~ 150 (386)
T PF14583_consen 76 ----TDGPGDNTFGGFLSPDDRALYYVKNGR-SLRRVDLDTLEERVVYEVPDDWKGYGTWVANSDCTKLVGIEISREDWK 150 (386)
T ss_dssp ------SS-B-TTT-EE-TTSSEEEEEETTT-EEEEEETTT--EEEEEE--TTEEEEEEEEE-TTSSEEEEEEEEGGG--
T ss_pred ----ccCCCCCccceEEecCCCeEEEEECCC-eEEEEECCcCcEEEEEECCcccccccceeeCCCccEEEEEEEeehhcc
Confidence 111112233567789888888766553 8999999998876666543 44444555 456766643311
Q ss_pred ----------------CCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCE-EEEEECCC-----eEEEEEEeCCC
Q 018806 275 ----------------DGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRM-ILLAFAGS-----LTLGSIHFASK 328 (350)
Q Consensus 275 ----------------d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~-l~~~~~~~-----~~~~~~~~~~~ 328 (350)
...|.-.|+++|+...+.....++..+.|||.... |++|..+. .++|.++....
T Consensus 151 ~l~~~~~f~e~~~a~p~~~i~~idl~tG~~~~v~~~~~wlgH~~fsP~dp~li~fCHEGpw~~Vd~RiW~i~~dg~ 226 (386)
T PF14583_consen 151 PLTKWKGFREFYEARPHCRIFTIDLKTGERKVVFEDTDWLGHVQFSPTDPTLIMFCHEGPWDLVDQRIWTINTDGS 226 (386)
T ss_dssp ---SHHHHHHHHHC---EEEEEEETTT--EEEEEEESS-EEEEEEETTEEEEEEEEE-S-TTTSS-SEEEEETTS-
T ss_pred CccccHHHHHHHhhCCCceEEEEECCCCceeEEEecCccccCcccCCCCCCEEEEeccCCcceeceEEEEEEcCCC
Confidence 13577778999988877777888999999996554 55554332 47888886543
No 390
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=95.58 E-value=0.0021 Score=56.52 Aligned_cols=145 Identities=16% Similarity=0.225 Sum_probs=102.3
Q ss_pred CCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP 222 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp 222 (350)
+-.......|-|.+..++.++.+..+..||-. ++.. +.....+....++|..
T Consensus 33 alv~pi~~~w~~e~~nlavaca~tiv~~YD~a-gq~~---------------------------le~n~tg~aldm~wDk 84 (615)
T KOG2247|consen 33 ALVGPIIHRWRPEGHNLAVACANTIVIYYDKA-GQVI---------------------------LELNPTGKALDMAWDK 84 (615)
T ss_pred hccccceeeEecCCCceehhhhhhHHHhhhhh-ccee---------------------------cccCCchhHhhhhhcc
Confidence 33344566888988888888888888888865 2211 1111124667888888
Q ss_pred CCCeEEEEEeCCCeEEEEeCCCCCceeeee-cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecccc-CCCCeEE
Q 018806 223 DGRYLASASYESSSFTIWDVAQGLGTPIRR-GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSS-TSGFVTG 300 (350)
Q Consensus 223 ~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~-~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~-~~~~v~~ 300 (350)
++..++......+.+.+||+.+.....+.. ....-.-+.|++-+..++.+...+.+.|++..+.......+ |...+++
T Consensus 85 egdvlavlAek~~piylwd~n~eytqqLE~gg~~s~sll~wsKg~~el~ig~~~gn~viynhgtsR~iiv~Gkh~RRgtq 164 (615)
T KOG2247|consen 85 EGDVLAVLAEKTGPIYLWDVNSEYTQQLESGGTSSKSLLAWSKGTPELVIGNNAGNIVIYNHGTSRRIIVMGKHQRRGTQ 164 (615)
T ss_pred ccchhhhhhhcCCCeeechhhhhhHHHHhccCcchHHHHhhccCCccccccccccceEEEeccchhhhhhhcccccceeE
Confidence 888776665555799999998765443322 22222237899999899988888999999988766655455 8889999
Q ss_pred EEEcCCCCEEEEEEC
Q 018806 301 ATWDPEGRMILLAFA 315 (350)
Q Consensus 301 ~~~s~~g~~l~~~~~ 315 (350)
++|.+.+..+...++
T Consensus 165 ~av~lEd~vil~dcd 179 (615)
T KOG2247|consen 165 IAVTLEDYVILCDCD 179 (615)
T ss_pred EEecccceeeecCcH
Confidence 999998887765554
No 391
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=95.56 E-value=1.4 Score=40.84 Aligned_cols=79 Identities=16% Similarity=0.059 Sum_probs=45.2
Q ss_pred CeEEEEeCCCCCceeeeecC---------CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeE--EEEE
Q 018806 235 SSFTIWDVAQGLGTPIRRGF---------GGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVT--GATW 303 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~---------~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~--~~~~ 303 (350)
|.+.-.|+.+++.+...... .+...-.....+..|++++.||.|+.+|.++|+..-.......+. -+.|
T Consensus 366 G~l~AlD~~tG~~~W~~~~~~~~~~~~~g~~~~~~~~~~~g~~v~~g~~dG~l~ald~~tG~~lW~~~~~~~~~a~P~~~ 445 (488)
T cd00216 366 GGLAALDPKTGKVVWEKREGTIRDSWNIGFPHWGGSLATAGNLVFAGAADGYFRAFDATTGKELWKFRTPSGIQATPMTY 445 (488)
T ss_pred eEEEEEeCCCCcEeeEeeCCccccccccCCcccCcceEecCCeEEEECCCCeEEEEECCCCceeeEEECCCCceEcCEEE
Confidence 57777777777655433222 111111111256688888899999999999999853332223332 2334
Q ss_pred cCCCCEEEEE
Q 018806 304 DPEGRMILLA 313 (350)
Q Consensus 304 s~~g~~l~~~ 313 (350)
..+|+..+..
T Consensus 446 ~~~g~~yv~~ 455 (488)
T cd00216 446 EVNGKQYVGV 455 (488)
T ss_pred EeCCEEEEEE
Confidence 5566554444
No 392
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.54 E-value=0.5 Score=42.69 Aligned_cols=136 Identities=13% Similarity=0.174 Sum_probs=80.4
Q ss_pred CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCC-------eEEEEecCCcEEEEecCCCCCCceeeccccccccee
Q 018806 121 TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGG-------RSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGAL 193 (350)
Q Consensus 121 ~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~-------~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~ 193 (350)
..++-.|+ ..|+.+..+.. +. .|.-+.+.|+.+ .-+.+-+++.|+-||.+..+.....
T Consensus 356 ~~l~klDI--E~GKIVeEWk~-~~-di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpRv~~~~kl~----------- 420 (644)
T KOG2395|consen 356 DKLYKLDI--ERGKIVEEWKF-ED-DINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPRVQGKNKLA----------- 420 (644)
T ss_pred Ccceeeec--ccceeeeEeec-cC-CcceeeccCCcchhcccccccEEeecCCceEEecccccCcceee-----------
Confidence 33444455 44666665532 33 377777777632 2345666788999998844431110
Q ss_pred cCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-e-eeeecCCCeEEEEEcCCCCEEEE
Q 018806 194 SRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-T-PIRRGFGGLSILKWSPTGDYFFA 271 (350)
Q Consensus 194 ~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~-~~~~~~~~v~~~~~sp~g~~l~~ 271 (350)
|...+.+... ....|++-..+| +|+.++.+ |.|++||- .+.. . .+.+-..+|..+..+.+|++|++
T Consensus 421 -------~~q~kqy~~k--~nFsc~aTT~sG-~IvvgS~~-GdIRLYdr-i~~~AKTAlPgLG~~I~hVdvtadGKwil~ 488 (644)
T KOG2395|consen 421 -------VVQSKQYSTK--NNFSCFATTESG-YIVVGSLK-GDIRLYDR-IGRRAKTALPGLGDAIKHVDVTADGKWILA 488 (644)
T ss_pred -------eeeccccccc--cccceeeecCCc-eEEEeecC-CcEEeehh-hhhhhhhcccccCCceeeEEeeccCcEEEE
Confidence 0001111111 234455554454 78889999 79999997 4432 2 23344578999999999999876
Q ss_pred EecCCeEEEEeCC
Q 018806 272 AKFDGTFYLWETN 284 (350)
Q Consensus 272 ~~~d~~v~iwd~~ 284 (350)
.+ +..+.+.++.
T Consensus 489 Tc-~tyLlLi~t~ 500 (644)
T KOG2395|consen 489 TC-KTYLLLIDTL 500 (644)
T ss_pred ec-ccEEEEEEEe
Confidence 54 5666666653
No 393
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=95.48 E-value=0.82 Score=40.70 Aligned_cols=222 Identities=12% Similarity=0.139 Sum_probs=88.3
Q ss_pred eeEEEEecCCCEEEEEE--------------------CCCeEEEEEccCCCCCceeEecCCCCC-CeeEEEEeeC--CCe
Q 018806 102 LQGVSWHQHKHIVAFIS--------------------GSTQVIVRDYEDSEGKDACILTSDSQR-DVKVLEWRPN--GGR 158 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s--------------------~d~~i~iw~~~~~~~~~~~~~~~~~~~-~v~~~~~sp~--~~~ 158 (350)
-+.+-|.|..+.+++.. ....+++||+.. .+....+..+.++ ....++|..+ ...
T Consensus 183 gYDfw~qpr~nvMiSSeWg~P~~~~~Gf~~~d~~~~~yG~~l~vWD~~~--r~~~Q~idLg~~g~~pLEvRflH~P~~~~ 260 (461)
T PF05694_consen 183 GYDFWYQPRHNVMISSEWGAPSMFEKGFNPEDLEAGKYGHSLHVWDWST--RKLLQTIDLGEEGQMPLEVRFLHDPDANY 260 (461)
T ss_dssp ---EEEETTTTEEEE-B---HHHHTT---TTTHHHH-S--EEEEEETTT--TEEEEEEES-TTEEEEEEEEE-SSTT--E
T ss_pred CCCeEEcCCCCEEEEeccCChhhcccCCChhHhhcccccCeEEEEECCC--CcEeeEEecCCCCCceEEEEecCCCCccc
Confidence 35667788778887743 235899999954 5555555444333 4668888654 222
Q ss_pred EEEEec-CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCC--CCCceeeEEECCCCCeEEEEEeCCC
Q 018806 159 SLSVGC-KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQ--NGEQITALSWGPDGRYLASASYESS 235 (350)
Q Consensus 159 l~~~~~-d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~v~~~~~sp~g~~l~~~~~d~g 235 (350)
=++++. ..+|..|--...+.- ..... ..+.......|.+-..++.. ...-|++|..|.|.++|+.++.-.|
T Consensus 261 gFvg~aLss~i~~~~k~~~g~W-~a~kV-----i~ip~~~v~~~~lp~ml~~~~~~P~LitDI~iSlDDrfLYvs~W~~G 334 (461)
T PF05694_consen 261 GFVGCALSSSIWRFYKDDDGEW-AAEKV-----IDIPAKKVEGWILPEMLKPFGAVPPLITDILISLDDRFLYVSNWLHG 334 (461)
T ss_dssp EEEEEE--EEEEEEEE-ETTEE-EEEEE-----EEE--EE--SS---GGGGGG-EE------EEE-TTS-EEEEEETTTT
T ss_pred eEEEEeccceEEEEEEcCCCCe-eeeEE-----EECCCcccCcccccccccccccCCCceEeEEEccCCCEEEEEcccCC
Confidence 222222 344444433211110 00000 00000000001111111110 0246899999999999999988779
Q ss_pred eEEEEeCCCCCceeeee--------------------cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCC
Q 018806 236 SFTIWDVAQGLGTPIRR--------------------GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTS 295 (350)
Q Consensus 236 ~i~iwd~~~~~~~~~~~--------------------~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~ 295 (350)
.|+.||+......++.. -.+...-+..|.||+.|.+.+. -..-||-+-. -......
T Consensus 335 dvrqYDISDP~~Pkl~gqv~lGG~~~~~~~~~v~g~~l~GgPqMvqlS~DGkRlYvTnS--Lys~WD~qfY--P~~~~~g 410 (461)
T PF05694_consen 335 DVRQYDISDPFNPKLVGQVFLGGSIRKGDHPVVKGKRLRGGPQMVQLSLDGKRLYVTNS--LYSAWDKQFY--PDGVKNG 410 (461)
T ss_dssp EEEEEE-SSTTS-EEEEEEE-BTTTT-B--TTS------S----EEE-TTSSEEEEE------HHHHHHHS--TT-----
T ss_pred cEEEEecCCCCCCcEEeEEEECcEeccCCCccccccccCCCCCeEEEccCCeEEEEEee--cccccccccC--CCccccc
Confidence 99999998764332221 0123456777888887765431 1111221000 0011223
Q ss_pred CCeEEEEEcCCCCEEEEEECCCeEEEEEEeCCCCC-CCceeecccc
Q 018806 296 GFVTGATWDPEGRMILLAFAGSLTLGSIHFASKPP-SLDAHLLPVD 340 (350)
Q Consensus 296 ~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~~~~-~~~~~~~~v~ 340 (350)
+....+.+.++.--|.. ...+.+++...+. ...+|+....
T Consensus 411 ~~m~~iDvd~~~Ggl~l-----~~~F~VDFg~ep~Gp~raHe~R~p 451 (461)
T PF05694_consen 411 SWMLKIDVDTENGGLTL-----DEDFLVDFGKEPDGPARAHEMRYP 451 (461)
T ss_dssp -EEEEEEE-TT-S-EEE-----EEEEEEE-TT-----SEEEEEEET
T ss_pred cEEEEEEecCCCCceee-----CccceecccccccccccceeeecC
Confidence 44556666665222221 3556666665443 3456665543
No 394
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.35 E-value=1.3 Score=41.91 Aligned_cols=49 Identities=8% Similarity=0.168 Sum_probs=38.3
Q ss_pred CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 121 TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 121 ~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
-.|+|++.. |.....+...|. .+-.+.|+.+ ..|++...+|++++|++-
T Consensus 64 ~~I~If~~s---G~lL~~~~w~~~-~lI~mgWs~~-eeLI~v~k~g~v~Vy~~~ 112 (829)
T KOG2280|consen 64 PYIRIFNIS---GQLLGRILWKHG-ELIGMGWSDD-EELICVQKDGTVHVYGLL 112 (829)
T ss_pred eeEEEEecc---ccchHHHHhcCC-CeeeecccCC-ceEEEEeccceEEEeecc
Confidence 357777764 665555554555 7889999988 899999999999999986
No 395
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.32 E-value=0.59 Score=41.47 Aligned_cols=101 Identities=13% Similarity=0.119 Sum_probs=70.4
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee--eee---cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCC
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP--IRR---GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTW 286 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~--~~~---~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~ 286 (350)
.+.|.++.||+|.+.||.--.++ +|.+++....+... ... ....|...+|+.+ .-+|.....| +-+|-....
T Consensus 66 ~G~I~SIkFSlDnkilAVQR~~~-~v~f~nf~~d~~~l~~~~~ck~k~~~IlGF~W~~s-~e~A~i~~~G-~e~y~v~pe 142 (657)
T KOG2377|consen 66 KGEIKSIKFSLDNKILAVQRTSK-TVDFCNFIPDNSQLEYTQECKTKNANILGFCWTSS-TEIAFITDQG-IEFYQVLPE 142 (657)
T ss_pred CCceeEEEeccCcceEEEEecCc-eEEEEecCCCchhhHHHHHhccCcceeEEEEEecC-eeEEEEecCC-eEEEEEchh
Confidence 36999999999999999998885 99999985443322 112 2345889999876 4566555444 566655443
Q ss_pred ce--eccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 287 TS--EPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 287 ~~--~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
+. +-...+...|.-..|.++-+.++.+++
T Consensus 143 krslRlVks~~~nvnWy~yc~et~v~LL~t~ 173 (657)
T KOG2377|consen 143 KRSLRLVKSHNLNVNWYMYCPETAVILLSTT 173 (657)
T ss_pred hhhhhhhhhcccCccEEEEccccceEeeecc
Confidence 32 445567778888899999887766653
No 396
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=95.30 E-value=0.18 Score=40.98 Aligned_cols=64 Identities=22% Similarity=0.304 Sum_probs=49.7
Q ss_pred EcCCCCEEEEEecCCeEEEEeCCCCcee-------ccc--------cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEe
Q 018806 262 WSPTGDYFFAAKFDGTFYLWETNTWTSE-------PWS--------STSGFVTGATWDPEGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 262 ~sp~g~~l~~~~~d~~v~iwd~~~~~~~-------~~~--------~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~ 325 (350)
+..++++|++.+.+|.+++||+.+++.. ++. .....|.++.++.+|.-|++-++++.+.|..++
T Consensus 18 l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~lsng~~y~y~~~L 96 (219)
T PF07569_consen 18 LECNGSYLLAITSSGLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLSNGDSYSYSPDL 96 (219)
T ss_pred EEeCCCEEEEEeCCCeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCCEEEEEeCCCEEEecccc
Confidence 4457889999999999999999998862 112 245678999999999988877777777666554
No 397
>PF14727 PHTB1_N: PTHB1 N-terminus
Probab=95.21 E-value=2.2 Score=38.32 Aligned_cols=157 Identities=15% Similarity=0.142 Sum_probs=90.1
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCc-eeEecCCCCCCeeEEEEe---e-CCCeEEEEecCCcEEEEecCCCCCCceeecc
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKD-ACILTSDSQRDVKVLEWR---P-NGGRSLSVGCKGGICIWAPSYPGNAASVRSG 185 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~-~~~~~~~~~~~v~~~~~s---p-~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~ 185 (350)
...|++||..|.++||+......+. -..+...-..+|..+..- + .....+++-.-+.+.||.+...... ...
T Consensus 37 ~d~IivGS~~G~LrIy~P~~~~~~~~~lllE~~l~~PILqv~~G~F~s~~~~~~LaVLhP~kl~vY~v~~~~g~--~~~- 113 (418)
T PF14727_consen 37 SDKIIVGSYSGILRIYDPSGNEFQPEDLLLETQLKDPILQVECGKFVSGSEDLQLAVLHPRKLSVYSVSLVDGT--VEH- 113 (418)
T ss_pred ccEEEEeccccEEEEEccCCCCCCCccEEEEEecCCcEEEEEeccccCCCCcceEEEecCCEEEEEEEEecCCC--ccc-
Confidence 4689999999999999985432121 122333456788877653 2 2345777778899999998422111 000
Q ss_pred cccccceecCCCCCceEEeeeccCCCCCceeeEEECC----C-CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEE
Q 018806 186 AASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP----D-GRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSIL 260 (350)
Q Consensus 186 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp----~-g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~ 260 (350)
+..+.+...+..+-......+.+-| . ..+|..-+.| |.+.+|+-+...........--...+
T Consensus 114 ------------g~~~~L~~~yeh~l~~~a~nm~~G~Fgg~~~~~~IcVQS~D-G~L~~feqe~~~f~~~lp~~llPgPl 180 (418)
T PF14727_consen 114 ------------GNQYQLELIYEHSLQRTAYNMCCGPFGGVKGRDFICVQSMD-GSLSFFEQESFAFSRFLPDFLLPGPL 180 (418)
T ss_pred ------------CcEEEEEEEEEEecccceeEEEEEECCCCCCceEEEEEecC-ceEEEEeCCcEEEEEEcCCCCCCcCe
Confidence 0112222111111122334444433 2 2456677888 89999997765433333332223346
Q ss_pred EEcCCCCEEEEEecCCeEEEEeC
Q 018806 261 KWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
+|++.-..+++++.+..+.-|..
T Consensus 181 ~Y~~~tDsfvt~sss~~l~~Yky 203 (418)
T PF14727_consen 181 CYCPRTDSFVTASSSWTLECYKY 203 (418)
T ss_pred EEeecCCEEEEecCceeEEEecH
Confidence 77777777888887777777754
No 398
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=95.20 E-value=0.084 Score=42.15 Aligned_cols=106 Identities=12% Similarity=0.070 Sum_probs=56.6
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEee-CCCeEEEEecCCcEEEEecCCCCCCceeecccccc
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRP-NGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASF 189 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp-~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~ 189 (350)
+..++.|+.+|.|.+|+++.. +....... .-...|.++--.- ++....+++.++.|+.|++...+..
T Consensus 70 ~~~~~vG~~dg~v~~~n~n~~-g~~~d~~~-s~~e~i~~~Ip~~~~~~~~c~~~~dg~ir~~n~~p~k~~---------- 137 (238)
T KOG2444|consen 70 SAKLMVGTSDGAVYVFNWNLE-GAHSDRVC-SGEESIDLGIPNGRDSSLGCVGAQDGRIRACNIKPNKVL---------- 137 (238)
T ss_pred CceEEeecccceEEEecCCcc-chHHHhhh-cccccceeccccccccceeEEeccCCceeeeccccCcee----------
Confidence 356888999999999998632 22111111 1122233322222 2223444555899999998833322
Q ss_pred cceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEE--EeCCCeEEEEeCCC
Q 018806 190 LGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASA--SYESSSFTIWDVAQ 244 (350)
Q Consensus 190 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~--~~d~g~i~iwd~~~ 244 (350)
.....|...++.....+..++.++++ +.+. .++.|++..
T Consensus 138 ---------------g~~g~h~~~~~e~~ivv~sd~~i~~a~~S~d~-~~k~W~ve~ 178 (238)
T KOG2444|consen 138 ---------------GYVGQHNFESGEELIVVGSDEFLKIADTSHDR-VLKKWNVEK 178 (238)
T ss_pred ---------------eeeccccCCCcceeEEecCCceEEeeccccch-hhhhcchhh
Confidence 11222222344445555556666666 6663 777777654
No 399
>PRK10115 protease 2; Provisional
Probab=95.18 E-value=1.1 Score=43.43 Aligned_cols=110 Identities=10% Similarity=0.050 Sum_probs=67.5
Q ss_pred ceeeEEECCCCCeEEEEEeCCC----eEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecC------CeEEEEeC
Q 018806 214 QITALSWGPDGRYLASASYESS----SFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFD------GTFYLWET 283 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g----~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d------~~v~iwd~ 283 (350)
.+..+.|+|||++|+.+...+| +|++.|+.++....... ...-..++|++|++.|+....+ ..|+.+++
T Consensus 128 ~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~i-~~~~~~~~w~~D~~~~~y~~~~~~~~~~~~v~~h~l 206 (686)
T PRK10115 128 TLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPELL-DNVEPSFVWANDSWTFYYVRKHPVTLLPYQVWRHTI 206 (686)
T ss_pred EEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCccc-cCcceEEEEeeCCCEEEEEEecCCCCCCCEEEEEEC
Confidence 5677899999999998755433 68899998886322111 1111459999999877665432 36888888
Q ss_pred CCCc--eeccc-cCCCCeE-EEEEcCCCCEEEEEE-CC-CeEEEEEE
Q 018806 284 NTWT--SEPWS-STSGFVT-GATWDPEGRMILLAF-AG-SLTLGSIH 324 (350)
Q Consensus 284 ~~~~--~~~~~-~~~~~v~-~~~~s~~g~~l~~~~-~~-~~~~~~~~ 324 (350)
.++. ...+. ....... .+..+.++++++..+ ++ +..++.+.
T Consensus 207 gt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~ 253 (686)
T PRK10115 207 GTPASQDELVYEEKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLD 253 (686)
T ss_pred CCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEE
Confidence 8873 22222 2222233 334455898877665 22 23455444
No 400
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.16 E-value=0.17 Score=49.29 Aligned_cols=65 Identities=14% Similarity=0.295 Sum_probs=49.3
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee-ecCC---CeEEEEEcCCCCEEEEEecCCe
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR-RGFG---GLSILKWSPTGDYFFAAKFDGT 277 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~-~~~~---~v~~~~~sp~g~~l~~~~~d~~ 277 (350)
.++|++++|+.+|+.++.|-.+ |.|.+||+..++..+.. .+.. ++..+.+..++..+.++...|.
T Consensus 130 ~~~Vtsvafn~dg~~l~~G~~~-G~V~v~D~~~~k~l~~i~e~~ap~t~vi~v~~t~~nS~llt~D~~Gs 198 (1206)
T KOG2079|consen 130 QGPVTSVAFNQDGSLLLAGLGD-GHVTVWDMHRAKILKVITEHGAPVTGVIFVGRTSQNSKLLTSDTGGS 198 (1206)
T ss_pred CCcceeeEecCCCceeccccCC-CcEEEEEccCCcceeeeeecCCccceEEEEEEeCCCcEEEEccCCCc
Confidence 4799999999999999999888 89999999998766543 3333 3444555556667777777775
No 401
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=94.99 E-value=0.12 Score=29.39 Aligned_cols=31 Identities=26% Similarity=0.407 Sum_probs=25.8
Q ss_pred CCeEEEEEcCCC---CEEEEEecCCeEEEEeCCC
Q 018806 255 GGLSILKWSPTG---DYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 255 ~~v~~~~~sp~g---~~l~~~~~d~~v~iwd~~~ 285 (350)
+.+.++.|+|.. .+|+.+-.-+.|.|+|+++
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 468899999854 4788888889999999995
No 402
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=94.85 E-value=2.8 Score=37.51 Aligned_cols=161 Identities=9% Similarity=0.111 Sum_probs=92.8
Q ss_pred eEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCcee
Q 018806 103 QGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASV 182 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~ 182 (350)
+.+-|.-..+.| .+...|.+.=|.....+...+..+.....++|.+++||+|.+.++..-.+.+|.+++.. +.++...
T Consensus 26 ngvFfDDaNkql-favrSggatgvvvkgpndDVpiSfdm~d~G~I~SIkFSlDnkilAVQR~~~~v~f~nf~-~d~~~l~ 103 (657)
T KOG2377|consen 26 NGVFFDDANKQL-FAVRSGGATGVVVKGPNDDVPISFDMDDKGEIKSIKFSLDNKILAVQRTSKTVDFCNFI-PDNSQLE 103 (657)
T ss_pred cceeeccCcceE-EEEecCCeeEEEEeCCCCCCCceeeecCCCceeEEEeccCcceEEEEecCceEEEEecC-CCchhhH
Confidence 444454333433 44555666677765443333333333456799999999996555556668999999885 2222111
Q ss_pred ecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCC--ceeeeecCCCeEEE
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGL--GTPIRRGFGGLSIL 260 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~--~~~~~~~~~~v~~~ 260 (350)
.. ...+..+ ..|..+.|+.+ .-+|..... -+.+|.+...+ ...+..+.-.|.-.
T Consensus 104 ~~--------------------~~ck~k~-~~IlGF~W~~s-~e~A~i~~~--G~e~y~v~pekrslRlVks~~~nvnWy 159 (657)
T KOG2377|consen 104 YT--------------------QECKTKN-ANILGFCWTSS-TEIAFITDQ--GIEFYQVLPEKRSLRLVKSHNLNVNWY 159 (657)
T ss_pred HH--------------------HHhccCc-ceeEEEEEecC-eeEEEEecC--CeEEEEEchhhhhhhhhhhcccCccEE
Confidence 11 0111222 46888999876 566666555 36666554432 33344566778888
Q ss_pred EEcCCCCEEEEEe--cCCeEEEEeCCCCcee
Q 018806 261 KWSPTGDYFFAAK--FDGTFYLWETNTWTSE 289 (350)
Q Consensus 261 ~~sp~g~~l~~~~--~d~~v~iwd~~~~~~~ 289 (350)
.|+++-+.+..++ ..+++.=+.++++...
T Consensus 160 ~yc~et~v~LL~t~~~~n~lnpf~~~~~~v~ 190 (657)
T KOG2377|consen 160 MYCPETAVILLSTTVLENVLNPFHFRAGTMS 190 (657)
T ss_pred EEccccceEeeeccccccccccEEEeeceee
Confidence 8898877654332 3455555555555443
No 403
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=94.79 E-value=2.9 Score=37.42 Aligned_cols=185 Identities=12% Similarity=0.063 Sum_probs=79.8
Q ss_pred eEEEEecCCCEEEEEE--C----CCeEEEEEccCCCCCceeEecCC--CCCCeeEEEEeeCCCeEEEEe-----------
Q 018806 103 QGVSWHQHKHIVAFIS--G----STQVIVRDYEDSEGKDACILTSD--SQRDVKVLEWRPNGGRSLSVG----------- 163 (350)
Q Consensus 103 ~~v~~sp~g~~la~~s--~----d~~i~iw~~~~~~~~~~~~~~~~--~~~~v~~~~~sp~~~~l~~~~----------- 163 (350)
..+-.-|+|+.++++- . -|.+.++|-++ .......... ....-..+-|.|.-+.++++.
T Consensus 133 HT~Hclp~G~imIS~lGd~~G~g~Ggf~llD~~t--f~v~g~We~~~~~~~~gYDfw~qpr~nvMiSSeWg~P~~~~~Gf 210 (461)
T PF05694_consen 133 HTVHCLPDGRIMISALGDADGNGPGGFVLLDGET--FEVKGRWEKDRGPQPFGYDFWYQPRHNVMISSEWGAPSMFEKGF 210 (461)
T ss_dssp EEEEE-SS--EEEEEEEETTS-S--EEEEE-TTT----EEEE--SB-TT------EEEETTTTEEEE-B---HHHHTT--
T ss_pred ceeeecCCccEEEEeccCCCCCCCCcEEEEcCcc--ccccceeccCCCCCCCCCCeEEcCCCCEEEEeccCChhhcccCC
Confidence 3344457898888853 2 24455666532 3333333221 223445677778755566542
Q ss_pred ---------cCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC--CCCeEEE-EE
Q 018806 164 ---------CKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP--DGRYLAS-AS 231 (350)
Q Consensus 164 ---------~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp--~g~~l~~-~~ 231 (350)
...++.+||+...+..+.+.-+. .......+.|.. +..+=++ +.
T Consensus 211 ~~~d~~~~~yG~~l~vWD~~~r~~~Q~idLg~------------------------~g~~pLEvRflH~P~~~~gFvg~a 266 (461)
T PF05694_consen 211 NPEDLEAGKYGHSLHVWDWSTRKLLQTIDLGE------------------------EGQMPLEVRFLHDPDANYGFVGCA 266 (461)
T ss_dssp -TTTHHHH-S--EEEEEETTTTEEEEEEES-T------------------------TEEEEEEEEE-SSTT--EEEEEEE
T ss_pred ChhHhhcccccCeEEEEECCCCcEeeEEecCC------------------------CCCceEEEEecCCCCccceEEEEe
Confidence 12579999998555444433321 112344555543 3333322 33
Q ss_pred eCCCeEEEEeC-CCCCce-----eeeec-----------------CCCeEEEEEcCCCCEEEEEe-cCCeEEEEeCCCCc
Q 018806 232 YESSSFTIWDV-AQGLGT-----PIRRG-----------------FGGLSILKWSPTGDYFFAAK-FDGTFYLWETNTWT 287 (350)
Q Consensus 232 ~d~g~i~iwd~-~~~~~~-----~~~~~-----------------~~~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~~~~ 287 (350)
.. .+|..|-- ..++.. .+-.. ..-++.+.+|.|.++|.++. .+|.|+.||+....
T Consensus 267 Ls-s~i~~~~k~~~g~W~a~kVi~ip~~~v~~~~lp~ml~~~~~~P~LitDI~iSlDDrfLYvs~W~~GdvrqYDISDP~ 345 (461)
T PF05694_consen 267 LS-SSIWRFYKDDDGEWAAEKVIDIPAKKVEGWILPEMLKPFGAVPPLITDILISLDDRFLYVSNWLHGDVRQYDISDPF 345 (461)
T ss_dssp ---EEEEEEEE-ETTEEEEEEEEEE--EE--SS---GGGGGG-EE------EEE-TTS-EEEEEETTTTEEEEEE-SSTT
T ss_pred cc-ceEEEEEEcCCCCeeeeEEEECCCcccCcccccccccccccCCCceEeEEEccCCCEEEEEcccCCcEEEEecCCCC
Confidence 33 35555533 333211 11000 23368899999999996554 58999999998754
Q ss_pred eeccc--------------------cCCCCeEEEEEcCCCCEEEEEE
Q 018806 288 SEPWS--------------------STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 288 ~~~~~--------------------~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.-.+. .-.+...-+..|.||+.|+++.
T Consensus 346 ~Pkl~gqv~lGG~~~~~~~~~v~g~~l~GgPqMvqlS~DGkRlYvTn 392 (461)
T PF05694_consen 346 NPKLVGQVFLGGSIRKGDHPVVKGKRLRGGPQMVQLSLDGKRLYVTN 392 (461)
T ss_dssp S-EEEEEEE-BTTTT-B--TTS------S----EEE-TTSSEEEEE-
T ss_pred CCcEEeEEEECcEeccCCCccccccccCCCCCeEEEccCCeEEEEEe
Confidence 31111 0122346788999999999884
No 404
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=94.70 E-value=0.14 Score=29.17 Aligned_cols=31 Identities=19% Similarity=0.282 Sum_probs=24.4
Q ss_pred CCeeEEEEeeCCC--eEEEEecC-CcEEEEecCC
Q 018806 145 RDVKVLEWRPNGG--RSLSVGCK-GGICIWAPSY 175 (350)
Q Consensus 145 ~~v~~~~~sp~~~--~l~~~~~d-~~v~iwd~~~ 175 (350)
+.|.+++|+|+.. .|++-+.+ +.|.|+|++.
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 4689999998755 56666665 9999999983
No 405
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=94.69 E-value=3.3 Score=37.69 Aligned_cols=54 Identities=13% Similarity=0.179 Sum_probs=35.0
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEe----cCCCCCCeeEEEEeeC
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACIL----TSDSQRDVKVLEWRPN 155 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~----~~~~~~~v~~~~~sp~ 155 (350)
-+.|+|.|||++|++--..|.|++++...........+ .....+....|+++|+
T Consensus 32 Pw~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~Pd 89 (454)
T TIGR03606 32 PWALLWGPDNQLWVTERATGKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPD 89 (454)
T ss_pred ceEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCC
Confidence 68899999998887654469998887543221111111 1113567899999987
No 406
>KOG2247 consensus WD40 repeat-containing protein [General function prediction only]
Probab=94.64 E-value=0.0065 Score=53.64 Aligned_cols=135 Identities=15% Similarity=0.210 Sum_probs=95.3
Q ss_pred EEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecCCCCCCcee
Q 018806 104 GVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPSYPGNAASV 182 (350)
Q Consensus 104 ~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~~~~~~~~~ 182 (350)
...|-|.+.-++.++.+..+..||-. ++..... ...+....++|.-+|..++.... .+.+.+||+. .+..+++
T Consensus 39 ~~~w~~e~~nlavaca~tiv~~YD~a---gq~~le~--n~tg~aldm~wDkegdvlavlAek~~piylwd~n-~eytqqL 112 (615)
T KOG2247|consen 39 IHRWRPEGHNLAVACANTIVIYYDKA---GQVILEL--NPTGKALDMAWDKEGDVLAVLAEKTGPIYLWDVN-SEYTQQL 112 (615)
T ss_pred eeeEecCCCceehhhhhhHHHhhhhh---cceeccc--CCchhHhhhhhccccchhhhhhhcCCCeeechhh-hhhHHHH
Confidence 34677777778888888888888853 4332322 34567788999888877776666 4999999998 3343333
Q ss_pred ecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee-cCCCeEEEE
Q 018806 183 RSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR-GFGGLSILK 261 (350)
Q Consensus 183 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~-~~~~v~~~~ 261 (350)
..+. . ..-.-+.|++.+..++.+... |.+.+++..+.......+ |...+.+++
T Consensus 113 E~gg-----------------------~--~s~sll~wsKg~~el~ig~~~-gn~viynhgtsR~iiv~Gkh~RRgtq~a 166 (615)
T KOG2247|consen 113 ESGG-----------------------T--SSKSLLAWSKGTPELVIGNNA-GNIVIYNHGTSRRIIVMGKHQRRGTQIA 166 (615)
T ss_pred hccC-----------------------c--chHHHHhhccCCccccccccc-cceEEEeccchhhhhhhcccccceeEEE
Confidence 3321 1 111227888888888888777 799999988877666666 778899999
Q ss_pred EcCCCCEEE
Q 018806 262 WSPTGDYFF 270 (350)
Q Consensus 262 ~sp~g~~l~ 270 (350)
|.+.+..+.
T Consensus 167 v~lEd~vil 175 (615)
T KOG2247|consen 167 VTLEDYVIL 175 (615)
T ss_pred ecccceeee
Confidence 998875443
No 407
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=94.61 E-value=2.6 Score=36.13 Aligned_cols=167 Identities=17% Similarity=0.295 Sum_probs=81.3
Q ss_pred EECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEE-EEecCCCCCCceeecccccccceecC
Q 018806 117 ISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGIC-IWAPSYPGNAASVRSGAASFLGALSR 195 (350)
Q Consensus 117 ~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~-iwd~~~~~~~~~~~~~~~~~~~~~~~ 195 (350)
++..|. ||.-.. .++.-..+...-.+.+..+.-++|| .+++++..|.+. -||-.. .
T Consensus 120 ~~~~G~--iy~T~D-gG~tW~~~~~~~~gs~~~~~r~~dG-~~vavs~~G~~~~s~~~G~--~----------------- 176 (302)
T PF14870_consen 120 AGDRGA--IYRTTD-GGKTWQAVVSETSGSINDITRSSDG-RYVAVSSRGNFYSSWDPGQ--T----------------- 176 (302)
T ss_dssp EETT----EEEESS-TTSSEEEEE-S----EEEEEE-TTS--EEEEETTSSEEEEE-TT---S-----------------
T ss_pred EcCCCc--EEEeCC-CCCCeeEcccCCcceeEeEEECCCC-cEEEEECcccEEEEecCCC--c-----------------
Confidence 344454 444432 2443344334556789999989996 466666666554 555431 1
Q ss_pred CCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCC-CCc-----eeeeecCCCeEEEEEcCCCCEE
Q 018806 196 GPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQ-GLG-----TPIRRGFGGLSILKWSPTGDYF 269 (350)
Q Consensus 196 ~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~-~~~-----~~~~~~~~~v~~~~~sp~g~~l 269 (350)
.|...... ....|.++.|+|++...+.+ .. |.|+.=+... ... ..+......+..++|.+++...
T Consensus 177 ----~w~~~~r~---~~~riq~~gf~~~~~lw~~~-~G-g~~~~s~~~~~~~~w~~~~~~~~~~~~~~ld~a~~~~~~~w 247 (302)
T PF14870_consen 177 ----TWQPHNRN---SSRRIQSMGFSPDGNLWMLA-RG-GQIQFSDDPDDGETWSEPIIPIKTNGYGILDLAYRPPNEIW 247 (302)
T ss_dssp ----S-EEEE-----SSS-EEEEEE-TTS-EEEEE-TT-TEEEEEE-TTEEEEE---B-TTSS--S-EEEEEESSSS-EE
T ss_pred ----cceEEccC---ccceehhceecCCCCEEEEe-CC-cEEEEccCCCCccccccccCCcccCceeeEEEEecCCCCEE
Confidence 12222211 23689999999998776654 55 6887776221 111 1111122458899999998777
Q ss_pred EEEecCCeEEEEeCCCCce-ec---cccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 270 FAAKFDGTFYLWETNTWTS-EP---WSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 270 ~~~~~d~~v~iwd~~~~~~-~~---~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
++|+ .|.+ +...+.|+. ++ .......++.+.|..+.+-++.|.++-
T Consensus 248 a~gg-~G~l-~~S~DgGktW~~~~~~~~~~~n~~~i~f~~~~~gf~lG~~G~ 297 (302)
T PF14870_consen 248 AVGG-SGTL-LVSTDGGKTWQKDRVGENVPSNLYRIVFVNPDKGFVLGQDGV 297 (302)
T ss_dssp EEES-TT-E-EEESSTTSS-EE-GGGTTSSS---EEEEEETTEEEEE-STTE
T ss_pred EEeC-CccE-EEeCCCCccceECccccCCCCceEEEEEcCCCceEEECCCcE
Confidence 7665 4433 445555654 22 123345688999987777777775543
No 408
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=94.56 E-value=2.1 Score=34.75 Aligned_cols=142 Identities=8% Similarity=0.013 Sum_probs=77.4
Q ss_pred CeeEEEEecCCCEEEEEEC----------CCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-CCcEE
Q 018806 101 DLQGVSWHQHKHIVAFISG----------STQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-KGGIC 169 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~----------d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~ 169 (350)
..+.-..+|+|++.+ |.. .|.++.|-.. ..+..+. ..-+--+.++|+.+.+.+.+..+ +-+|.
T Consensus 110 R~NDgkvdP~Gryy~-GtMad~~~~le~~~g~Ly~~~~~----h~v~~i~-~~v~IsNgl~Wd~d~K~fY~iDsln~~V~ 183 (310)
T KOG4499|consen 110 RLNDGKVDPDGRYYG-GTMADFGDDLEPIGGELYSWLAG----HQVELIW-NCVGISNGLAWDSDAKKFYYIDSLNYEVD 183 (310)
T ss_pred ccccCccCCCCceee-eeeccccccccccccEEEEeccC----CCceeee-hhccCCccccccccCcEEEEEccCceEEe
Confidence 455666789999844 322 2445555542 1112221 22334467899988666666555 57787
Q ss_pred EEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee
Q 018806 170 IWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP 249 (350)
Q Consensus 170 iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~ 249 (350)
-||.+.+.-...-... -+.+.+ .+....-..-.++...+|...+++-.. |+|...|..+|+...
T Consensus 184 a~dyd~~tG~~snr~~--------------i~dlrk-~~~~e~~~PDGm~ID~eG~L~Va~~ng-~~V~~~dp~tGK~L~ 247 (310)
T KOG4499|consen 184 AYDYDCPTGDLSNRKV--------------IFDLRK-SQPFESLEPDGMTIDTEGNLYVATFNG-GTVQKVDPTTGKILL 247 (310)
T ss_pred eeecCCCcccccCcce--------------eEEecc-CCCcCCCCCCcceEccCCcEEEEEecC-cEEEEECCCCCcEEE
Confidence 7886532211000000 000111 011000122345556677777766666 799999999998765
Q ss_pred -eeecCCCeEEEEEcC
Q 018806 250 -IRRGFGGLSILKWSP 264 (350)
Q Consensus 250 -~~~~~~~v~~~~~sp 264 (350)
+.-....++++||--
T Consensus 248 eiklPt~qitsccFgG 263 (310)
T KOG4499|consen 248 EIKLPTPQITSCCFGG 263 (310)
T ss_pred EEEcCCCceEEEEecC
Confidence 334567899999963
No 409
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=94.47 E-value=1.7 Score=42.11 Aligned_cols=73 Identities=15% Similarity=0.288 Sum_probs=51.7
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCC----------CCc----eeee--------ecCCCeEEEEEcCC---CC
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQ----------GLG----TPIR--------RGFGGLSILKWSPT---GD 267 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~----------~~~----~~~~--------~~~~~v~~~~~sp~---g~ 267 (350)
..|..+.++|+|++++..+.. | |.|..+.. ++. ..+. .....|..+.|+|. +.
T Consensus 85 f~v~~i~~n~~g~~lal~G~~-~-v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~~ 162 (717)
T PF10168_consen 85 FEVHQISLNPTGSLLALVGPR-G-VVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESDS 162 (717)
T ss_pred eeEEEEEECCCCCEEEEEcCC-c-EEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCCC
Confidence 578999999999999999887 3 44444421 111 1110 12246889999996 57
Q ss_pred EEEEEecCCeEEEEeCCCCc
Q 018806 268 YFFAAKFDGTFYLWETNTWT 287 (350)
Q Consensus 268 ~l~~~~~d~~v~iwd~~~~~ 287 (350)
.|++-..|+++++||+....
T Consensus 163 ~l~vLtsdn~lR~y~~~~~~ 182 (717)
T PF10168_consen 163 HLVVLTSDNTLRLYDISDPQ 182 (717)
T ss_pred eEEEEecCCEEEEEecCCCC
Confidence 89888999999999997543
No 410
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=94.47 E-value=2.8 Score=35.92 Aligned_cols=102 Identities=20% Similarity=0.350 Sum_probs=58.7
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC-CCCce--
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWET-NTWTS-- 288 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~-~~~~~-- 288 (350)
+.+..+.-++||++++++...+ ...-||--...-... ......+..+.|+|++...+.+ ..|.|++=+. ...+.
T Consensus 145 gs~~~~~r~~dG~~vavs~~G~-~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~-~Gg~~~~s~~~~~~~~w~ 222 (302)
T PF14870_consen 145 GSINDITRSSDGRYVAVSSRGN-FYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLA-RGGQIQFSDDPDDGETWS 222 (302)
T ss_dssp --EEEEEE-TTS-EEEEETTSS-EEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEE-TTTEEEEEE-TTEEEEE-
T ss_pred ceeEeEEECCCCcEEEEECccc-EEEEecCCCccceEEccCccceehhceecCCCCEEEEe-CCcEEEEccCCCCccccc
Confidence 6788899999999988886653 556777543333332 2345789999999998876654 7888888772 22221
Q ss_pred ---eccccCCCCeEEEEEcCCCCEEEEEECC
Q 018806 289 ---EPWSSTSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 289 ---~~~~~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
.........+.+++|.+++...++++++
T Consensus 223 ~~~~~~~~~~~~~ld~a~~~~~~~wa~gg~G 253 (302)
T PF14870_consen 223 EPIIPIKTNGYGILDLAYRPPNEIWAVGGSG 253 (302)
T ss_dssp --B-TTSS--S-EEEEEESSSS-EEEEESTT
T ss_pred cccCCcccCceeeEEEEecCCCCEEEEeCCc
Confidence 1122233458999999998888876554
No 411
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=94.44 E-value=0.95 Score=44.83 Aligned_cols=101 Identities=16% Similarity=0.123 Sum_probs=66.5
Q ss_pred CceeeEEECCCCC-eEEEEEeCCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 213 EQITALSWGPDGR-YLASASYESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 213 ~~v~~~~~sp~g~-~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
....++.|.|.-. ..+....| +.|++..+........ ..-....++++|+|.|+.++.|...|++.-|-..-.....
T Consensus 156 vf~~~~~wnP~vp~n~av~l~d-lsl~V~~~~~~~~~v~s~p~t~~~Tav~WSprGKQl~iG~nnGt~vQy~P~leik~~ 234 (1405)
T KOG3630|consen 156 VFQLKNVWNPLVPLNSAVDLSD-LSLRVKSTKQLAQNVTSFPVTNSQTAVLWSPRGKQLFIGRNNGTEVQYEPSLEIKSE 234 (1405)
T ss_pred cccccccccCCccchhhhhccc-cchhhhhhhhhhhhhcccCcccceeeEEeccccceeeEecCCCeEEEeecccceeec
Confidence 3556788888633 33444455 5788776654322221 2234568899999999999999999999888654322211
Q ss_pred cc----cCCCCeEEEEEcCCCCEEEEEE
Q 018806 291 WS----STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 291 ~~----~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
+. .....|.++.|-....+|++-.
T Consensus 235 ip~Pp~~e~yrvl~v~Wl~t~eflvvy~ 262 (1405)
T KOG3630|consen 235 IPEPPVEENYRVLSVTWLSTQEFLVVYG 262 (1405)
T ss_pred ccCCCcCCCcceeEEEEecceeEEEEec
Confidence 11 2257899999988888877654
No 412
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=94.08 E-value=2.5 Score=33.86 Aligned_cols=162 Identities=10% Similarity=0.068 Sum_probs=83.7
Q ss_pred CEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC---C---cEEEE-ecCCC-CCCceee
Q 018806 112 HIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK---G---GICIW-APSYP-GNAASVR 183 (350)
Q Consensus 112 ~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d---~---~v~iw-d~~~~-~~~~~~~ 183 (350)
+.|..+...+.|.+|++........+.+ .--+.|..+.++..|.++++.-.+ . .+|+| |.+.. .....+.
T Consensus 29 d~Lfva~~g~~Vev~~l~~~~~~~~~~F--~Tv~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~NWr~~~~~~~~v~ 106 (215)
T PF14761_consen 29 DALFVAASGCKVEVYDLEQEECPLLCTF--STVGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFNWRSQKEENSPVR 106 (215)
T ss_pred ceEEEEcCCCEEEEEEcccCCCceeEEE--cchhheeEEEeccccceEEEEEeecCCccceEEEEEEEhhhhcccCCcEE
Confidence 4554556778899999974334444444 345789999999999999887654 2 45655 22211 1111111
Q ss_pred --cccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc----eeee------
Q 018806 184 --SGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG----TPIR------ 251 (350)
Q Consensus 184 --~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~----~~~~------ 251 (350)
-..................+ +.-.....+.+++..|-.-.|+.++.+ ++.+|.+..... ..+.
T Consensus 107 vRiaG~~v~~~~~~~~~~qlei---iElPl~~~p~ciaCC~~tG~LlVg~~~--~l~lf~l~~~~~~~~~~~~lDFe~~l 181 (215)
T PF14761_consen 107 VRIAGHRVTPSFNESSKDQLEI---IELPLSEPPLCIACCPVTGNLLVGCGN--KLVLFTLKYQTIQSEKFSFLDFERSL 181 (215)
T ss_pred EEEcccccccCCCCccccceEE---EEecCCCCCCEEEecCCCCCEEEEcCC--EEEEEEEEEEEEecccccEEechhhh
Confidence 00000000011111111222 222223578899999865556666555 799997764422 0111
Q ss_pred -ecC--CCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 252 -RGF--GGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 252 -~~~--~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
.+. -.+..+++. +.++|..+ +..++++.+
T Consensus 182 ~~~~~~~~p~~v~ic--~~yiA~~s-~~ev~Vlkl 213 (215)
T PF14761_consen 182 IDHIDNFKPTQVAIC--EGYIAVMS-DLEVLVLKL 213 (215)
T ss_pred hheecCceEEEEEEE--eeEEEEec-CCEEEEEEE
Confidence 111 123445553 45777665 555666654
No 413
>KOG3630 consensus Nuclear pore complex, Nup214/CAN component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=93.99 E-value=0.46 Score=46.88 Aligned_cols=146 Identities=12% Similarity=0.113 Sum_probs=87.8
Q ss_pred ccCeeEEEEecCCCEEEEEE--CCCeEEEEEccCCCCCc--eeE------ecCCCCCCeeEEEEeeCCC-eEEEEecCCc
Q 018806 99 EVDLQGVSWHQHKHIVAFIS--GSTQVIVRDYEDSEGKD--ACI------LTSDSQRDVKVLEWRPNGG-RSLSVGCKGG 167 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s--~d~~i~iw~~~~~~~~~--~~~------~~~~~~~~v~~~~~sp~~~-~l~~~~~d~~ 167 (350)
..++..+..++|++..++.. ++-.|..||+..-.... ... ..........++.|+|.-. ..++...|+.
T Consensus 100 ~~pi~~~v~~~D~t~s~v~~tsng~~v~~fD~~~fs~s~~~~~~pl~~s~ts~ek~vf~~~~~wnP~vp~n~av~l~dls 179 (1405)
T KOG3630|consen 100 EIPIVIFVCFHDATDSVVVSTSNGEAVYSFDLEEFSESRYETTVPLKNSATSFEKPVFQLKNVWNPLVPLNSAVDLSDLS 179 (1405)
T ss_pred cccceEEEeccCCceEEEEEecCCceEEEEehHhhhhhhhhhccccccccchhccccccccccccCCccchhhhhccccc
Confidence 44677778888887666543 34477788875321111 001 1112234567788887632 3455566788
Q ss_pred EEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc
Q 018806 168 ICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG 247 (350)
Q Consensus 168 v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~ 247 (350)
|++..+........ .+ ......++++|+|.|+.++.+-.. |++.-|-..-...
T Consensus 180 l~V~~~~~~~~~v~------------------------s~--p~t~~~Tav~WSprGKQl~iG~nn-Gt~vQy~P~leik 232 (1405)
T KOG3630|consen 180 LRVKSTKQLAQNVT------------------------SF--PVTNSQTAVLWSPRGKQLFIGRNN-GTEVQYEPSLEIK 232 (1405)
T ss_pred hhhhhhhhhhhhhc------------------------cc--CcccceeeEEeccccceeeEecCC-CeEEEeeccccee
Confidence 88876652211100 00 112578999999999999999888 7998886543322
Q ss_pred eeeee----cCCCeEEEEEcCCCCEEEE
Q 018806 248 TPIRR----GFGGLSILKWSPTGDYFFA 271 (350)
Q Consensus 248 ~~~~~----~~~~v~~~~~sp~g~~l~~ 271 (350)
..+.. ....|.+++|-....++++
T Consensus 233 ~~ip~Pp~~e~yrvl~v~Wl~t~eflvv 260 (1405)
T KOG3630|consen 233 SEIPEPPVEENYRVLSVTWLSTQEFLVV 260 (1405)
T ss_pred ecccCCCcCCCcceeEEEEecceeEEEE
Confidence 22211 2467999999887777754
No 414
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=93.91 E-value=2.4 Score=38.48 Aligned_cols=62 Identities=16% Similarity=0.202 Sum_probs=47.9
Q ss_pred CCCEEEEEecCCeEEEEeCCCCce-eccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 265 TGDYFFAAKFDGTFYLWETNTWTS-EPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 265 ~g~~l~~~~~d~~v~iwd~~~~~~-~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
..-++|+++..|.|++||--.... ..+.+.+..|..+..+.+|++|+++|..-..+..+.+.
T Consensus 572 esGyIa~as~kGDirLyDRig~rAKtalP~lG~aIk~idvta~Gk~ilaTCk~yllL~d~~ik 634 (776)
T COG5167 572 ESGYIAAASRKGDIRLYDRIGKRAKTALPGLGDAIKHIDVTANGKHILATCKNYLLLTDVPIK 634 (776)
T ss_pred cCceEEEecCCCceeeehhhcchhhhcCcccccceeeeEeecCCcEEEEeecceEEEEecccc
Confidence 345899999999999999654443 34667778899999999999999888766666665554
No 415
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=93.79 E-value=6.7 Score=37.72 Aligned_cols=110 Identities=7% Similarity=-0.058 Sum_probs=64.2
Q ss_pred ceeeEEECC--CCCeEEEEEeCCCeEEEEeCCCC--------------C------ceeeeecCCCeEEEEEc--CCCCEE
Q 018806 214 QITALSWGP--DGRYLASASYESSSFTIWDVAQG--------------L------GTPIRRGFGGLSILKWS--PTGDYF 269 (350)
Q Consensus 214 ~v~~~~~sp--~g~~l~~~~~d~g~i~iwd~~~~--------------~------~~~~~~~~~~v~~~~~s--p~g~~l 269 (350)
.|..+...- +...|+.+..| |.|.+|.++.- . +.....-...+++++++ ...++|
T Consensus 102 tIN~i~v~~lg~~EVLl~c~Dd-G~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~v~~SaWGLdIh~~~~~rlI 180 (717)
T PF08728_consen 102 TINFIKVGDLGGEEVLLLCTDD-GDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFFHLRVGASAWGLDIHDYKKSRLI 180 (717)
T ss_pred eeeEEEecccCCeeEEEEEecC-CeEEEEEHHHHHHHHHhhccccccccccccCCCCeEeecCCceeEEEEEecCcceEE
Confidence 456665544 23455556555 89999965210 0 11122234568889998 778888
Q ss_pred EEEecCCeEEEEeCCCCce----eccccCCCCeEEEEEcCCC-----C-EEEEEECCCeEEEEEEe
Q 018806 270 FAAKFDGTFYLWETNTWTS----EPWSSTSGFVTGATWDPEG-----R-MILLAFAGSLTLGSIHF 325 (350)
Q Consensus 270 ~~~~~d~~v~iwd~~~~~~----~~~~~~~~~v~~~~~s~~g-----~-~l~~~~~~~~~~~~~~~ 325 (350)
|+++....|.||-+...+. .....+...|-+++|-++. . +|++++ =.+.++.+++
T Consensus 181 AVSsNs~~VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~d-I~G~v~~~~I 245 (717)
T PF08728_consen 181 AVSSNSQEVTVFAFALVDERFYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVATD-ISGEVWTFKI 245 (717)
T ss_pred EEecCCceEEEEEEeccccccccccccccccCCCeeEeecCCCCCccceEEEEEe-ccCcEEEEEE
Confidence 8888888787776544221 1222456678889987654 2 444444 3334555555
No 416
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=93.78 E-value=0.53 Score=38.34 Aligned_cols=67 Identities=13% Similarity=0.291 Sum_probs=49.2
Q ss_pred ECCCCCeEEEEEeCCCeEEEEeCCCCCce-------eee--------ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCC
Q 018806 220 WGPDGRYLASASYESSSFTIWDVAQGLGT-------PIR--------RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 220 ~sp~g~~l~~~~~d~g~i~iwd~~~~~~~-------~~~--------~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~ 284 (350)
+..++.+|++.+.+ |.+++||+.+++.. ++. .....|..+.++.+|.-|++-+ +|..+.|+.+
T Consensus 18 l~~~~~~Ll~iT~~-G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~ls-ng~~y~y~~~ 95 (219)
T PF07569_consen 18 LECNGSYLLAITSS-GLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLS-NGDSYSYSPD 95 (219)
T ss_pred EEeCCCEEEEEeCC-CeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCCEEEEEe-CCCEEEeccc
Confidence 34568889998889 89999999987542 112 2345688889998998777665 5788999876
Q ss_pred CCce
Q 018806 285 TWTS 288 (350)
Q Consensus 285 ~~~~ 288 (350)
-+.-
T Consensus 96 L~~W 99 (219)
T PF07569_consen 96 LGCW 99 (219)
T ss_pred ccee
Confidence 6544
No 417
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=93.75 E-value=0.86 Score=44.05 Aligned_cols=85 Identities=19% Similarity=0.335 Sum_probs=59.1
Q ss_pred ccCeeEEEEecCCCEEEEEECCCeEEEEEccCC---C-----CC--ceeEec--------CCCCCCeeEEEEeeC---CC
Q 018806 99 EVDLQGVSWHQHKHIVAFISGSTQVIVRDYEDS---E-----GK--DACILT--------SDSQRDVKVLEWRPN---GG 157 (350)
Q Consensus 99 ~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~---~-----~~--~~~~~~--------~~~~~~v~~~~~sp~---~~ 157 (350)
.+.|..|.+||+|++||..+..| |.|..+... . ++ ..+... ..+...|..+.|+|. +.
T Consensus 84 ~f~v~~i~~n~~g~~lal~G~~~-v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~~ 162 (717)
T PF10168_consen 84 LFEVHQISLNPTGSLLALVGPRG-VVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESDS 162 (717)
T ss_pred ceeEEEEEECCCCCEEEEEcCCc-EEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCCC
Confidence 46899999999999999988766 445554211 0 11 122111 134457899999997 47
Q ss_pred eEEEEecCCcEEEEecCCCCCCceeec
Q 018806 158 RSLSVGCKGGICIWAPSYPGNAASVRS 184 (350)
Q Consensus 158 ~l~~~~~d~~v~iwd~~~~~~~~~~~~ 184 (350)
++++-.+|+++++||+.....+..+..
T Consensus 163 ~l~vLtsdn~lR~y~~~~~~~p~~v~~ 189 (717)
T PF10168_consen 163 HLVVLTSDNTLRLYDISDPQHPWQVLS 189 (717)
T ss_pred eEEEEecCCEEEEEecCCCCCCeEEEE
Confidence 899999999999999986665555433
No 418
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=93.73 E-value=5.1 Score=36.21 Aligned_cols=68 Identities=9% Similarity=0.108 Sum_probs=45.9
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee--cCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR--GFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~--~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
+++..++.||+|+++|.-..+ |.+.+.+..-.+...... .......+.|+-+...++.- ...|.+...
T Consensus 217 ~~i~~iavSpng~~iAl~t~~-g~l~v~ssDf~~~~~e~~~~~~~~p~~~~WCG~dav~l~~--~~~l~lvg~ 286 (410)
T PF04841_consen 217 GPIIKIAVSPNGKFIALFTDS-GNLWVVSSDFSEKLCEFDTDSKSPPKQMAWCGNDAVVLSW--EDELLLVGP 286 (410)
T ss_pred CCeEEEEECCCCCEEEEEECC-CCEEEEECcccceeEEeecCcCCCCcEEEEECCCcEEEEe--CCEEEEECC
Confidence 579999999999999988877 799888765443332222 23567788888765433332 455666653
No 419
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=93.70 E-value=0.44 Score=26.82 Aligned_cols=41 Identities=20% Similarity=0.042 Sum_probs=26.7
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEE
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKW 262 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~ 262 (350)
|++++|+++....++|.++|..+++......-......++|
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~vg~~P~~i~~ 41 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPVGGYPFGVAV 41 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEECCCCCceEEe
Confidence 67888888776557999999987765543333333444444
No 420
>COG4590 ABC-type uncharacterized transport system, permease component [General function prediction only]
Probab=93.10 E-value=0.89 Score=40.40 Aligned_cols=164 Identities=13% Similarity=0.132 Sum_probs=90.3
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCC----Cee-EEEEeeCCCeEEEEecCCcEEEE-ec
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQR----DVK-VLEWRPNGGRSLSVGCKGGICIW-AP 173 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~----~v~-~~~~sp~~~~l~~~~~d~~v~iw-d~ 173 (350)
.+|..+-..|||++|..-+. ..+.++++....-+. ..+.....+ .|+ .+..-..|..+++...||-|.-| |+
T Consensus 221 ~~v~qllL~Pdg~~LYv~~g-~~~~v~~L~~r~l~~-rkl~~dspg~~~~~Vte~l~lL~Gg~SLLv~~~dG~vsQWFdv 298 (733)
T COG4590 221 SDVSQLLLTPDGKTLYVRTG-SELVVALLDKRSLQI-RKLVDDSPGDSRHQVTEQLYLLSGGFSLLVVHEDGLVSQWFDV 298 (733)
T ss_pred cchHhhEECCCCCEEEEecC-CeEEEEeecccccch-hhhhhcCCCchHHHHHHHHHHHhCceeEEEEcCCCceeeeeee
Confidence 36888899999999887655 678888886432211 122111111 122 22222334567777788877666 55
Q ss_pred CCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeec
Q 018806 174 SYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRG 253 (350)
Q Consensus 174 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~ 253 (350)
.....+.. ...+.++-. ...+..+.-..+.+-+++-... |++..+.....+.......
T Consensus 299 r~~~~p~l--------------------~h~R~f~l~-pa~~~~l~pe~~rkgF~~l~~~-G~L~~f~st~~~~lL~~~~ 356 (733)
T COG4590 299 RRDGQPHL--------------------NHIRNFKLA-PAEVQFLLPETNRKGFYSLYRN-GTLQSFYSTSEKLLLFERA 356 (733)
T ss_pred ecCCCCcc--------------------eeeeccccC-cccceeeccccccceEEEEcCC-CceeeeecccCcceehhhh
Confidence 43322111 111111111 1233333322333445555555 6887776554443333333
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
...+.-+++||.+.++++- +.|.++++.+++...
T Consensus 357 ~~~~~~~~~Sp~~~~Ll~e-~~gki~~~~l~Nr~P 390 (733)
T COG4590 357 YQAPQLVAMSPNQAYLLSE-DQGKIRLAQLENRNP 390 (733)
T ss_pred hcCcceeeeCcccchheee-cCCceEEEEecCCCC
Confidence 3467778999999988764 357799998887654
No 421
>PRK13684 Ycf48-like protein; Provisional
Probab=92.76 E-value=6.3 Score=34.51 Aligned_cols=152 Identities=13% Similarity=0.129 Sum_probs=80.9
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
.+.++.+.|++.+++++ ..|.+.. ..+ ..++.-..........++++.+.++++ ++.++..|.+.+=..+ .+.
T Consensus 174 ~~~~i~~~~~g~~v~~g-~~G~i~~-s~~-~gg~tW~~~~~~~~~~l~~i~~~~~g~-~~~vg~~G~~~~~s~d-~G~-- 246 (334)
T PRK13684 174 VVRNLRRSPDGKYVAVS-SRGNFYS-TWE-PGQTAWTPHQRNSSRRLQSMGFQPDGN-LWMLARGGQIRFNDPD-DLE-- 246 (334)
T ss_pred eEEEEEECCCCeEEEEe-CCceEEE-EcC-CCCCeEEEeeCCCcccceeeeEcCCCC-EEEEecCCEEEEccCC-CCC--
Confidence 57889999998777654 4554432 111 112222333334456899999999854 5556666766432222 111
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeee---ecCCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIR---RGFGG 256 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~---~~~~~ 256 (350)
.|.....-.......+.++.+.++++.+++ +.+ |.+. .....++. .... .-...
T Consensus 247 -------------------sW~~~~~~~~~~~~~l~~v~~~~~~~~~~~-G~~-G~v~-~S~d~G~tW~~~~~~~~~~~~ 304 (334)
T PRK13684 247 -------------------SWSKPIIPEITNGYGYLDLAYRTPGEIWAG-GGN-GTLL-VSKDGGKTWEKDPVGEEVPSN 304 (334)
T ss_pred -------------------ccccccCCccccccceeeEEEcCCCCEEEE-cCC-CeEE-EeCCCCCCCeECCcCCCCCcc
Confidence 111110000001135788899998775554 455 5554 34444432 2221 11235
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEEe
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLWE 282 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iwd 282 (350)
...+.|..+++.+++| ..|.|-.|+
T Consensus 305 ~~~~~~~~~~~~~~~G-~~G~il~~~ 329 (334)
T PRK13684 305 FYKIVFLDPEKGFVLG-QRGVLLRYV 329 (334)
T ss_pred eEEEEEeCCCceEEEC-CCceEEEec
Confidence 7778887776666654 567776554
No 422
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=92.68 E-value=9.3 Score=36.25 Aligned_cols=152 Identities=16% Similarity=0.129 Sum_probs=78.8
Q ss_pred cCCCEEEEEECC------CeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecC------CcEEEEecCCC
Q 018806 109 QHKHIVAFISGS------TQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCK------GGICIWAPSYP 176 (350)
Q Consensus 109 p~g~~la~~s~d------~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d------~~v~iwd~~~~ 176 (350)
..+.+++.|+.. ..+..+|...+... ..........-.+++...+ ..++++|.+ .++..||....
T Consensus 283 ~~~~l~~vGG~~~~~~~~~~ve~yd~~~~~w~--~~a~m~~~r~~~~~~~~~~-~lYv~GG~~~~~~~l~~ve~YD~~~~ 359 (571)
T KOG4441|consen 283 VSGKLVAVGGYNRQGQSLRSVECYDPKTNEWS--SLAPMPSPRCRVGVAVLNG-KLYVVGGYDSGSDRLSSVERYDPRTN 359 (571)
T ss_pred CCCeEEEECCCCCCCcccceeEEecCCcCcEe--ecCCCCcccccccEEEECC-EEEEEccccCCCcccceEEEecCCCC
Confidence 345677777766 35667777542211 1111123344555565544 566666666 34556665522
Q ss_pred CCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCC-----eEEEEeCCCCCceeee
Q 018806 177 GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESS-----SFTIWDVAQGLGTPIR 251 (350)
Q Consensus 177 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g-----~i~iwd~~~~~~~~~~ 251 (350)
.|.....+.... ....... -+|...+.|+.+ | ++..||..+.+.....
T Consensus 360 -----------------------~W~~~a~M~~~R-~~~~v~~--l~g~iYavGG~d-g~~~l~svE~YDp~~~~W~~va 412 (571)
T KOG4441|consen 360 -----------------------QWTPVAPMNTKR-SDFGVAV--LDGKLYAVGGFD-GEKSLNSVECYDPVTNKWTPVA 412 (571)
T ss_pred -----------------------ceeccCCccCcc-ccceeEE--ECCEEEEEeccc-cccccccEEEecCCCCcccccC
Confidence 222222222211 1111111 256777777776 4 5888998877654433
Q ss_pred ecCCCeEEEEE-cCCCCEEEEEecCC------eEEEEeCCCCceec
Q 018806 252 RGFGGLSILKW-SPTGDYFFAAKFDG------TFYLWETNTWTSEP 290 (350)
Q Consensus 252 ~~~~~v~~~~~-sp~g~~l~~~~~d~------~v~iwd~~~~~~~~ 290 (350)
.........+. .-+|+..++|+.++ ++..||..+.+-..
T Consensus 413 ~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YDP~t~~W~~ 458 (571)
T KOG4441|consen 413 PMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYDPETNTWTL 458 (571)
T ss_pred CCCcceeeeEEEEECCEEEEEcCcCCCccccceEEEEcCCCCceee
Confidence 22222222221 23677777777543 68889998877643
No 423
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=92.58 E-value=0.61 Score=25.87 Aligned_cols=28 Identities=32% Similarity=0.682 Sum_probs=21.4
Q ss_pred CceeeEEECCCCCeEEEEEeCC--CeEEEE
Q 018806 213 EQITALSWGPDGRYLASASYES--SSFTIW 240 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~--g~i~iw 240 (350)
+......|||||+.|+.++... |...||
T Consensus 9 ~~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 9 GDDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp SSEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred ccccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 4678899999999999998775 555555
No 424
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=92.49 E-value=6.8 Score=34.19 Aligned_cols=173 Identities=20% Similarity=0.299 Sum_probs=94.4
Q ss_pred CCCeeEEEEeeCCCeEEEEecCCc------EEEEecCCC-CCCceeecccccccceecCCCCCceEEeeeccCCCCCcee
Q 018806 144 QRDVKVLEWRPNGGRSLSVGCKGG------ICIWAPSYP-GNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQIT 216 (350)
Q Consensus 144 ~~~v~~~~~sp~~~~l~~~~~d~~------v~iwd~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~ 216 (350)
-+.+..+.+.+++..+++.+.++. +..+++... .....+.... ...+...... .+... .....
T Consensus 19 ~GGlSgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~---~~~L~~~~G~------~~~~~-~~D~E 88 (326)
T PF13449_consen 19 FGGLSGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILD---MIPLRDPDGQ------PFPKN-GLDPE 88 (326)
T ss_pred cCcEeeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEecc---ceeccCCCCC------cCCcC-CCChh
Confidence 356889999977778888887776 555555531 1111111100 0000000000 01100 12445
Q ss_pred eEEECCCCCeEEEEEeC------CCeEEEEeCCCCCce-ee---------------eecCCCeEEEEEcCCCCEEEEEec
Q 018806 217 ALSWGPDGRYLASASYE------SSSFTIWDVAQGLGT-PI---------------RRGFGGLSILKWSPTGDYFFAAKF 274 (350)
Q Consensus 217 ~~~~sp~g~~l~~~~~d------~g~i~iwd~~~~~~~-~~---------------~~~~~~v~~~~~sp~g~~l~~~~~ 274 (350)
++++.++|.++++.-.+ . .|+.++.. |... .+ ...+...-+++++|+|+.|+++.+
T Consensus 89 gi~~~~~g~~~is~E~~~~~~~~p-~I~~~~~~-G~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E 166 (326)
T PF13449_consen 89 GIAVPPDGSFWISSEGGRTGGIPP-RIRRFDLD-GRVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAME 166 (326)
T ss_pred HeEEecCCCEEEEeCCccCCCCCC-EEEEECCC-CcccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEEC
Confidence 78887777777665444 4 78888866 4321 11 113456889999999996665532
Q ss_pred -----CC--e-------EEEE--eCCC-Cce-ec----ccc-----CCCCeEEEEEcCCCCEEEEEEC------CCeEEE
Q 018806 275 -----DG--T-------FYLW--ETNT-WTS-EP----WSS-----TSGFVTGATWDPEGRMILLAFA------GSLTLG 321 (350)
Q Consensus 275 -----d~--~-------v~iw--d~~~-~~~-~~----~~~-----~~~~v~~~~~s~~g~~l~~~~~------~~~~~~ 321 (350)
|+ . ++++ |..+ ++. .+ +.. ....++.+.+-+++++|+.==+ ....++
T Consensus 167 ~~l~~d~~~~~~~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~d~~lLvLER~~~~~~~~~~ri~ 246 (326)
T PF13449_consen 167 SPLKQDGPRANPDNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALPDGRLLVLERDFSPGTGNYKRIY 246 (326)
T ss_pred ccccCCCcccccccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEECCCcEEEEEccCCCCccceEEEE
Confidence 22 1 4555 4444 211 11 111 4567899999999998776322 346777
Q ss_pred EEEeCCC
Q 018806 322 SIHFASK 328 (350)
Q Consensus 322 ~~~~~~~ 328 (350)
.+++...
T Consensus 247 ~v~l~~a 253 (326)
T PF13449_consen 247 RVDLSDA 253 (326)
T ss_pred EEEcccc
Confidence 7776643
No 425
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=92.47 E-value=1.5 Score=29.74 Aligned_cols=51 Identities=16% Similarity=0.246 Sum_probs=36.6
Q ss_pred ecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEE
Q 018806 273 KFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSI 323 (350)
Q Consensus 273 ~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~ 323 (350)
..+|.+.-||..+++...+...-...+.++.++|+.+|+++-....++...
T Consensus 34 ~~~GRll~ydp~t~~~~vl~~~L~fpNGVals~d~~~vlv~Et~~~Ri~ry 84 (89)
T PF03088_consen 34 RPTGRLLRYDPSTKETTVLLDGLYFPNGVALSPDESFVLVAETGRYRILRY 84 (89)
T ss_dssp ---EEEEEEETTTTEEEEEEEEESSEEEEEE-TTSSEEEEEEGGGTEEEEE
T ss_pred CCCcCEEEEECCCCeEEEehhCCCccCeEEEcCCCCEEEEEeccCceEEEE
Confidence 345789999999998866665555779999999999999987555555443
No 426
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=92.46 E-value=0.65 Score=25.75 Aligned_cols=24 Identities=21% Similarity=0.574 Sum_probs=17.7
Q ss_pred ccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 292 SSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 292 ~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
..........+|||||++|+.++.
T Consensus 5 t~~~~~~~~p~~SpDGk~i~f~s~ 28 (39)
T PF07676_consen 5 TNSPGDDGSPAWSPDGKYIYFTSN 28 (39)
T ss_dssp S-SSSSEEEEEE-TTSSEEEEEEE
T ss_pred ccCCccccCEEEecCCCEEEEEec
Confidence 344556788999999999999873
No 427
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=92.27 E-value=1.9 Score=29.31 Aligned_cols=39 Identities=15% Similarity=0.149 Sum_probs=32.6
Q ss_pred CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe
Q 018806 235 SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK 273 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~ 273 (350)
|.+..||..+++...+...-.....+++++|+.+|+.+-
T Consensus 37 GRll~ydp~t~~~~vl~~~L~fpNGVals~d~~~vlv~E 75 (89)
T PF03088_consen 37 GRLLRYDPSTKETTVLLDGLYFPNGVALSPDESFVLVAE 75 (89)
T ss_dssp EEEEEEETTTTEEEEEEEEESSEEEEEE-TTSSEEEEEE
T ss_pred cCEEEEECCCCeEEEehhCCCccCeEEEcCCCCEEEEEe
Confidence 789999999998877777777889999999999887764
No 428
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=92.25 E-value=6.5 Score=35.87 Aligned_cols=103 Identities=16% Similarity=0.151 Sum_probs=60.7
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCcee------ee--ecCCCeEEEEEcCCC------CEEEEEe-----
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTP------IR--RGFGGLSILKWSPTG------DYFFAAK----- 273 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~------~~--~~~~~v~~~~~sp~g------~~l~~~~----- 273 (350)
...+.|+|.|||+.|++--.. |.|++++-.++.... +. ...+....++++|+- .+|....
T Consensus 30 ~~Pw~maflPDG~llVtER~~-G~I~~v~~~~~~~~~~~~l~~v~~~~ge~GLlglal~PdF~~~~~n~~lYvsyt~~~~ 108 (454)
T TIGR03606 30 NKPWALLWGPDNQLWVTERAT-GKILRVNPETGEVKVVFTLPEIVNDAQHNGLLGLALHPDFMQEKGNPYVYISYTYKNG 108 (454)
T ss_pred CCceEEEEcCCCeEEEEEecC-CEEEEEeCCCCceeeeecCCceeccCCCCceeeEEECCCccccCCCcEEEEEEeccCC
Confidence 467899999999877765445 799999866543221 11 135778999999874 2443331
Q ss_pred -----cCCeEEEEeCCCC--ce---eccc-----cCCCCeEEEEEcCCCCEEEEEECC
Q 018806 274 -----FDGTFYLWETNTW--TS---EPWS-----STSGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 274 -----~d~~v~iwd~~~~--~~---~~~~-----~~~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
....|.-|.+... .. ..+. .....-..|+|.|||.+.++.++.
T Consensus 109 ~~~~~~~~~I~R~~l~~~~~~l~~~~~Il~~lP~~~~H~GgrI~FgPDG~LYVs~GD~ 166 (454)
T TIGR03606 109 DKELPNHTKIVRYTYDKSTQTLEKPVDLLAGLPAGNDHNGGRLVFGPDGKIYYTIGEQ 166 (454)
T ss_pred CCCccCCcEEEEEEecCCCCccccceEEEecCCCCCCcCCceEEECCCCcEEEEECCC
Confidence 1234544554321 11 1111 111234578899999876655544
No 429
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=92.24 E-value=2.9 Score=36.54 Aligned_cols=98 Identities=19% Similarity=0.280 Sum_probs=54.6
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeee-------ecCCCeEEEEEcCC---CCEE-EEEecC------
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIR-------RGFGGLSILKWSPT---GDYF-FAAKFD------ 275 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~-------~~~~~v~~~~~sp~---g~~l-~~~~~d------ 275 (350)
..++|+|.|||+.+++ ... |.|++++ ..+.. ..+. ........++++|+ ..+| ++.+..
T Consensus 3 ~P~~~a~~pdG~l~v~-e~~-G~i~~~~-~~g~~~~~v~~~~~v~~~~~~gllgia~~p~f~~n~~lYv~~t~~~~~~~~ 79 (331)
T PF07995_consen 3 NPRSMAFLPDGRLLVA-ERS-GRIWVVD-KDGSLKTPVADLPEVFADGERGLLGIAFHPDFASNGYLYVYYTNADEDGGD 79 (331)
T ss_dssp SEEEEEEETTSCEEEE-ETT-TEEEEEE-TTTEECEEEEE-TTTBTSTTBSEEEEEE-TTCCCC-EEEEEEEEE-TSSSS
T ss_pred CceEEEEeCCCcEEEE-eCC-ceEEEEe-CCCcCcceecccccccccccCCcccceeccccCCCCEEEEEEEcccCCCCC
Confidence 4688999999977665 445 8999999 33332 2211 23467899999994 2344 333321
Q ss_pred --CeEEEEeCCCC--ce---ec----cc---cCCCCeEEEEEcCCCCEEEEEE
Q 018806 276 --GTFYLWETNTW--TS---EP----WS---STSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 276 --~~v~iwd~~~~--~~---~~----~~---~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
..|.-|....+ .. .. +. .....-..|+|.|||.+.++.+
T Consensus 80 ~~~~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgpDG~LYvs~G 132 (331)
T PF07995_consen 80 NDNRVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGPDGKLYVSVG 132 (331)
T ss_dssp EEEEEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-TTSEEEEEEB
T ss_pred cceeeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCCCCcEEEEeC
Confidence 24444544433 11 11 11 1234557799999996655544
No 430
>KOG2280 consensus Vacuolar assembly/sorting protein VPS16 [Intracellular trafficking, secretion, and vesicular transport]
Probab=92.23 E-value=11 Score=36.07 Aligned_cols=95 Identities=9% Similarity=0.103 Sum_probs=56.2
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee--cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceec
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR--GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEP 290 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~--~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~ 290 (350)
+.+..++.||+.++|+.-... |.|.+-+.+..+...-.. .......++|.-+. -++.+.+..+.+..-......-
T Consensus 217 ~~~~ki~VS~n~~~laLyt~~-G~i~~vs~D~~~~lce~~~~~~~~p~qm~Wcgnd--aVvl~~e~~l~lvgp~gd~V~f 293 (829)
T KOG2280|consen 217 SSVVKISVSPNRRFLALYTET-GKIWVVSIDLSQILCEFNCTDHDPPKQMAWCGND--AVVLSWEVNLMLVGPPGDSVQF 293 (829)
T ss_pred ceEEEEEEcCCcceEEEEecC-CcEEEEecchhhhhhccCCCCCCchHhceeecCC--ceEEEEeeeEEEEcCCCCcccc
Confidence 577889999999999888877 799988877665432221 22334477887655 2333344455555443333322
Q ss_pred cccCCCCeEEEEEcCCCCEEEEE
Q 018806 291 WSSTSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 291 ~~~~~~~v~~~~~s~~g~~l~~~ 313 (350)
+..+. .+ +.--+||-.|++.
T Consensus 294 ~yd~t-~~--l~~E~DGVRI~t~ 313 (829)
T KOG2280|consen 294 YYDET-AI--LSAEVDGVRIITS 313 (829)
T ss_pred ccCCC-ce--eeeccCeeEEecc
Confidence 22222 22 5556778777765
No 431
>PF10395 Utp8: Utp8 family; InterPro: IPR018843 Utp8 is an essential component of the nuclear tRNA export machinery in Saccharomyces cerevisiae (Baker's yeast). It is a tRNA binding protein that acts at a step between tRNA maturation /aminoacylation, and translocation of the tRNA across the nuclear pore complex [].
Probab=92.05 E-value=11 Score=35.82 Aligned_cols=32 Identities=22% Similarity=0.203 Sum_probs=28.1
Q ss_pred CCCCeeEEEEeeCCCeEEEEecCCcEEEEecC
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCKGGICIWAPS 174 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~ 174 (350)
-+..|-.+.|.++++.+++.-..|.|.+||+.
T Consensus 128 l~~kvv~Ik~~~~~~~I~vvl~nG~i~~~d~~ 159 (670)
T PF10395_consen 128 LDDKVVGIKFSSDGKIIYVVLENGSIQIYDFS 159 (670)
T ss_pred cccceEEEEEecCCCEEEEEEcCCcEEEEecc
Confidence 35679999999998889889999999999993
No 432
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=91.80 E-value=6.8 Score=32.69 Aligned_cols=117 Identities=14% Similarity=0.032 Sum_probs=67.0
Q ss_pred CCCCeeEEEEeeCCCeEEEEecC--CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEE
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCK--GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSW 220 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d--~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~ 220 (350)
...-...+.|..+|..+-++|.- ..|+.+|+.+++...... +... ---..++.
T Consensus 43 ~~aFTQGL~~~~~g~LyESTG~yG~S~l~~~d~~tg~~~~~~~-----------------------l~~~--~FgEGit~ 97 (264)
T PF05096_consen 43 PTAFTQGLEFLDDGTLYESTGLYGQSSLRKVDLETGKVLQSVP-----------------------LPPR--YFGEGITI 97 (264)
T ss_dssp TT-EEEEEEEEETTEEEEEECSTTEEEEEEEETTTSSEEEEEE------------------------TTT----EEEEEE
T ss_pred CcccCccEEecCCCEEEEeCCCCCcEEEEEEECCCCcEEEEEE-----------------------CCcc--ccceeEEE
Confidence 33456678887776555666654 578888887443221111 1111 01122232
Q ss_pred CCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce
Q 018806 221 GPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
. +..|.--+..+|...+||..+.+........+.-+.++ .||+.|+.......++++|.++.+.
T Consensus 98 ~--~d~l~qLTWk~~~~f~yd~~tl~~~~~~~y~~EGWGLt--~dg~~Li~SDGS~~L~~~dP~~f~~ 161 (264)
T PF05096_consen 98 L--GDKLYQLTWKEGTGFVYDPNTLKKIGTFPYPGEGWGLT--SDGKRLIMSDGSSRLYFLDPETFKE 161 (264)
T ss_dssp E--TTEEEEEESSSSEEEEEETTTTEEEEEEE-SSS--EEE--ECSSCEEEE-SSSEEEEE-TTT-SE
T ss_pred E--CCEEEEEEecCCeEEEEccccceEEEEEecCCcceEEE--cCCCEEEEECCccceEEECCcccce
Confidence 2 33444445555799999999877666555556666666 5778888877788999999988765
No 433
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=91.73 E-value=0.93 Score=25.43 Aligned_cols=40 Identities=18% Similarity=0.214 Sum_probs=25.9
Q ss_pred CCCCEEEEEe-cCCeEEEEeCCCCceeccccCCCCeEEEEE
Q 018806 264 PTGDYFFAAK-FDGTFYLWETNTWTSEPWSSTSGFVTGATW 303 (350)
Q Consensus 264 p~g~~l~~~~-~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~ 303 (350)
|++++|+++. .+++|.++|..+++......-......++|
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~~~~~~i~vg~~P~~i~~ 41 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATNKVIATIPVGGYPFGVAV 41 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCCeEEEEEECCCCCceEEe
Confidence 5778776654 578999999988876443333334445554
No 434
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=91.65 E-value=15 Score=36.36 Aligned_cols=153 Identities=14% Similarity=0.237 Sum_probs=89.0
Q ss_pred CCCCCeeEEEEe---eC---CCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCC--CCC
Q 018806 142 DSQRDVKVLEWR---PN---GGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQ--NGE 213 (350)
Q Consensus 142 ~~~~~v~~~~~s---p~---~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~ 213 (350)
.-..+|..|+|. .. ...++++-....+.|+.............. ...+ ....+..+..+ .+.
T Consensus 77 ~~~~PI~qI~fa~~~~~~~~~~~~l~Vrt~~st~I~~p~~~~~~~~~~~~----~s~i------~~~~l~~i~~~~tgg~ 146 (765)
T PF10214_consen 77 DDGSPIKQIKFATLSESFDEKSRWLAVRTETSTTILRPEYHRVISSIRSR----PSRI------DPNPLLTISSSDTGGF 146 (765)
T ss_pred CCCCCeeEEEecccccccCCcCcEEEEEcCCEEEEEEcccccccccccCC----cccc------ccceeEEechhhcCCC
Confidence 356789999997 21 125777777788888885433220000000 0000 00111122211 124
Q ss_pred ceeeEEECCC-CCeEEEEEeCCCeEEEEeCCCCCc-----eeee-ecC----------CCeEEEEEcCCCCEEEEEecCC
Q 018806 214 QITALSWGPD-GRYLASASYESSSFTIWDVAQGLG-----TPIR-RGF----------GGLSILKWSPTGDYFFAAKFDG 276 (350)
Q Consensus 214 ~v~~~~~sp~-g~~l~~~~~d~g~i~iwd~~~~~~-----~~~~-~~~----------~~v~~~~~sp~g~~l~~~~~d~ 276 (350)
...+++|+|. .+.||..... |...||++..... .... ... ..-..+.|.++-..|++++ ..
T Consensus 147 ~~aDv~FnP~~~~q~AiVD~~-G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv~~-r~ 224 (765)
T PF10214_consen 147 PHADVAFNPWDQRQFAIVDEK-GNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLVCN-RS 224 (765)
T ss_pred ccceEEeccCccceEEEEecc-CcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEEEc-CC
Confidence 6788999994 5678888888 8999999922111 1111 111 2234788988877787775 46
Q ss_pred eEEEEeCCCCceec-c--ccCCCCeEEEEEcCC
Q 018806 277 TFYLWETNTWTSEP-W--SSTSGFVTGATWDPE 306 (350)
Q Consensus 277 ~v~iwd~~~~~~~~-~--~~~~~~v~~~~~s~~ 306 (350)
.+.++|+++..... + ......|..+.-+++
T Consensus 225 ~l~~~d~~~~~~~~~l~~~~~~~~IlDv~~~~~ 257 (765)
T PF10214_consen 225 KLMLIDFESNWQTEYLVTAKTWSWILDVKRSPD 257 (765)
T ss_pred ceEEEECCCCCccchhccCCChhheeeEEecCC
Confidence 68999999877633 2 234567888888876
No 435
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=91.43 E-value=4.4 Score=29.80 Aligned_cols=63 Identities=8% Similarity=-0.021 Sum_probs=41.2
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCC---CCEEEEEecCCeEEEEeCCCCce
Q 018806 224 GRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPT---GDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~---g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
...|+.++.. .+..||+..........-..++.++.+-.- ..-++..+.+..|.-||.+..+.
T Consensus 64 ~D~LliGt~t--~llaYDV~~N~d~Fyke~~DGvn~i~~g~~~~~~~~l~ivGGncsi~Gfd~~G~e~ 129 (136)
T PF14781_consen 64 RDCLLIGTQT--SLLAYDVENNSDLFYKEVPDGVNAIVIGKLGDIPSPLVIVGGNCSIQGFDYEGNEI 129 (136)
T ss_pred cCEEEEeccc--eEEEEEcccCchhhhhhCccceeEEEEEecCCCCCcEEEECceEEEEEeCCCCcEE
Confidence 4456666665 799999998877766666678887776431 22344444467777777665443
No 436
>TIGR02171 Fb_sc_TIGR02171 Fibrobacter succinogenes paralogous family TIGR02171. This model describes a paralogous family of the rumen bacterium Fibrobacter succinogenes. Eleven members are found in Fibrobacter succinogenes S85, averaging over 900 amino acids in length. More than half are predicted lipoproteins. The function is unknown.
Probab=91.28 E-value=2 Score=41.98 Aligned_cols=87 Identities=14% Similarity=0.128 Sum_probs=61.1
Q ss_pred eEEEEEeCCCeEEEEeCCCCCceee-eecCCCeEEEEEcCCCCEEEE-EecCC-----eEEEEeCCCCce--eccccCCC
Q 018806 226 YLASASYESSSFTIWDVAQGLGTPI-RRGFGGLSILKWSPTGDYFFA-AKFDG-----TFYLWETNTWTS--EPWSSTSG 296 (350)
Q Consensus 226 ~l~~~~~d~g~i~iwd~~~~~~~~~-~~~~~~v~~~~~sp~g~~l~~-~~~d~-----~v~iwd~~~~~~--~~~~~~~~ 296 (350)
.|+......|.+.+-|........+ ..+...+.+.+|||||+.|+. .+..+ .|++-|+.+... ..+.-...
T Consensus 320 kiAfv~~~~~~L~~~D~dG~n~~~ve~~~~~~i~sP~~SPDG~~vAY~ts~e~~~g~s~vYv~~L~t~~~~~vkl~ve~a 399 (912)
T TIGR02171 320 KLAFRNDVTGNLAYIDYTKGASRAVEIEDTISVYHPDISPDGKKVAFCTGIEGLPGKSSVYVRNLNASGSGLVKLPVENA 399 (912)
T ss_pred eEEEEEcCCCeEEEEecCCCCceEEEecCCCceecCcCCCCCCEEEEEEeecCCCCCceEEEEehhccCCCceEeecccc
Confidence 4666554335899999988777766 677889999999999999987 44333 588889876443 44444455
Q ss_pred CeEEEEEcCCCCEEEE
Q 018806 297 FVTGATWDPEGRMILL 312 (350)
Q Consensus 297 ~v~~~~~s~~g~~l~~ 312 (350)
.|-.-...++|..+++
T Consensus 400 aiprwrv~e~gdt~iv 415 (912)
T TIGR02171 400 AIPRWRVLENGDTVIV 415 (912)
T ss_pred cccceEecCCCCeEEE
Confidence 6666666777766544
No 437
>PRK13684 Ycf48-like protein; Provisional
Probab=91.19 E-value=9.8 Score=33.34 Aligned_cols=146 Identities=15% Similarity=0.167 Sum_probs=83.0
Q ss_pred CCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEEC
Q 018806 142 DSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWG 221 (350)
Q Consensus 142 ~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~s 221 (350)
+....+.++.+.|+ +.+++.+..|.+..- ....+. .|.. +.......++++.+.
T Consensus 170 ~~~g~~~~i~~~~~-g~~v~~g~~G~i~~s-~~~gg~---------------------tW~~---~~~~~~~~l~~i~~~ 223 (334)
T PRK13684 170 DAAGVVRNLRRSPD-GKYVAVSSRGNFYST-WEPGQT---------------------AWTP---HQRNSSRRLQSMGFQ 223 (334)
T ss_pred CCcceEEEEEECCC-CeEEEEeCCceEEEE-cCCCCC---------------------eEEE---eeCCCcccceeeeEc
Confidence 34567899999998 466677777765432 111111 1222 222223588999999
Q ss_pred CCCCeEEEEEeCCCeEEEEeCCCCCc-eeeee----cCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-ecc---c
Q 018806 222 PDGRYLASASYESSSFTIWDVAQGLG-TPIRR----GFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS-EPW---S 292 (350)
Q Consensus 222 p~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~~----~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~-~~~---~ 292 (350)
++++.++++ .. |.+.+=..+.+.. ..... ....+..+.+.++++.++++ .+|.+. ...+.++. ... .
T Consensus 224 ~~g~~~~vg-~~-G~~~~~s~d~G~sW~~~~~~~~~~~~~l~~v~~~~~~~~~~~G-~~G~v~-~S~d~G~tW~~~~~~~ 299 (334)
T PRK13684 224 PDGNLWMLA-RG-GQIRFNDPDDLESWSKPIIPEITNGYGYLDLAYRTPGEIWAGG-GNGTLL-VSKDGGKTWEKDPVGE 299 (334)
T ss_pred CCCCEEEEe-cC-CEEEEccCCCCCccccccCCccccccceeeEEEcCCCCEEEEc-CCCeEE-EeCCCCCCCeECCcCC
Confidence 998877665 44 5664323444432 11111 12457788999988765554 567554 33444443 222 1
Q ss_pred cCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 293 STSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 293 ~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
......+.+.|..+++.+++|..+.
T Consensus 300 ~~~~~~~~~~~~~~~~~~~~G~~G~ 324 (334)
T PRK13684 300 EVPSNFYKIVFLDPEKGFVLGQRGV 324 (334)
T ss_pred CCCcceEEEEEeCCCceEEECCCce
Confidence 2223578888888888877665443
No 438
>COG1506 DAP2 Dipeptidyl aminopeptidases/acylaminoacyl-peptidases [Amino acid transport and metabolism]
Probab=90.99 E-value=8.5 Score=37.00 Aligned_cols=168 Identities=14% Similarity=0.192 Sum_probs=94.5
Q ss_pred CccCeeEEEEecCCCEEEEEECCC--eEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCC
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGST--QVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSY 175 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~--~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~ 175 (350)
.+..+..+.|+|+|..++..+.++ ...+|.+... + .. ..+...+....|+|++..++....++..+.-+.
T Consensus 58 ~~~~~~~~~~spdg~~~~~~~~~~~~~~~l~l~~~~-g----~~-~~~~~~v~~~~~~~~g~~~~~~~~~~~~~~~~~-- 129 (620)
T COG1506 58 FGGGVSELRWSPDGSVLAFVSTDGGRVAQLYLVDVG-G----LI-TKTAFGVSDARWSPDGDRIAFLTAEGASKRDGG-- 129 (620)
T ss_pred cCCcccccccCCCCCEEEEEeccCCCcceEEEEecC-C----ce-eeeecccccceeCCCCCeEEEEecccccccCCc--
Confidence 345688889999999999877433 3456665433 2 11 235567889999999888877211110000000
Q ss_pred CCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCC
Q 018806 176 PGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFG 255 (350)
Q Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~ 255 (350)
.+..-.=..+.|...+ ... ..+.+.|..+ ..........
T Consensus 130 ---------------------------------~~~~~~~~~~~~~~~g------~~~-~~l~~~d~~~-~~~~~~~~~~ 168 (620)
T COG1506 130 ---------------------------------DHLFVDRLPVWFDGRG------GER-SDLYVVDIES-KLIKLGLGNL 168 (620)
T ss_pred ---------------------------------eeeeecccceeecCCC------Ccc-cceEEEccCc-ccccccCCCC
Confidence 0000000111222222 223 2556666555 3333444556
Q ss_pred CeEEEEEcCCCCEEEEEecCC-------eEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEE
Q 018806 256 GLSILKWSPTGDYFFAAKFDG-------TFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~-------~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
.+....+++++..++....+. ...++...++....+......+..+.|.++|+.++..+
T Consensus 169 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~gk~~~~~~ 234 (620)
T COG1506 169 DVVSFATDGDGRLVASIRLDDDADPWVTNLYVLIEGNGELESLTPGEGSISKLAFDADGKSIALLG 234 (620)
T ss_pred ceeeeeeCCCCceeEEeeeccccCCceEeeEEEecCCCceEEEcCCCceeeeeeeCCCCCeeEEec
Confidence 677777777777776554332 23444445666666666667789999999999766654
No 439
>PHA02713 hypothetical protein; Provisional
Probab=90.76 E-value=5.8 Score=37.55 Aligned_cols=65 Identities=5% Similarity=0.015 Sum_probs=38.5
Q ss_pred CCCeEEEEEeCC-----CeEEEEeCCC-CCceeeeecC---CCeEEEEEcCCCCEEEEEecCC--eEEEEeCCCCcee
Q 018806 223 DGRYLASASYES-----SSFTIWDVAQ-GLGTPIRRGF---GGLSILKWSPTGDYFFAAKFDG--TFYLWETNTWTSE 289 (350)
Q Consensus 223 ~g~~l~~~~~d~-----g~i~iwd~~~-~~~~~~~~~~---~~v~~~~~sp~g~~l~~~~~d~--~v~iwd~~~~~~~ 289 (350)
+|+..+.|+.++ ..+..||..+ .+...+..-. .....+.+ +|+..++|+.++ .+..||..+.+-.
T Consensus 463 ~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~~~~--~~~iyv~Gg~~~~~~~e~yd~~~~~W~ 538 (557)
T PHA02713 463 KDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLSALHTILH--DNTIMMLHCYESYMLQDTFNVYTYEWN 538 (557)
T ss_pred CCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCcccccceeEEE--CCEEEEEeeecceeehhhcCccccccc
Confidence 466666665431 1467899887 5544322211 12222222 777788888888 7788888877654
No 440
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=90.59 E-value=12 Score=33.54 Aligned_cols=150 Identities=15% Similarity=0.129 Sum_probs=80.8
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCce-eEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDA-CILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~-~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
...+..+++|.+++++.....++-|+- +... ..........+.++.|.+++ .++.++..|.+..- .. .+...
T Consensus 241 f~~v~~~~dG~~~~vg~~G~~~~s~d~----G~~~W~~~~~~~~~~l~~v~~~~dg-~l~l~g~~G~l~~S-~d-~G~~~ 313 (398)
T PLN00033 241 FSTVNRSPDGDYVAVSSRGNFYLTWEP----GQPYWQPHNRASARRIQNMGWRADG-GLWLLTRGGGLYVS-KG-TGLTE 313 (398)
T ss_pred eeeEEEcCCCCEEEEECCccEEEecCC----CCcceEEecCCCccceeeeeEcCCC-CEEEEeCCceEEEe-cC-CCCcc
Confidence 344567788888877654443334553 3221 22223455678999999885 45556666665432 22 11110
Q ss_pred eeecccccccceecCCCCCceEEeeeccCC-CCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCc-eeee---ecCC
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQ-NGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLG-TPIR---RGFG 255 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~-~~~~---~~~~ 255 (350)
... -+..+... ....+.++.|.+++..++++ .. |.+.... ..++. .... ....
T Consensus 314 ~~~-------------------~f~~~~~~~~~~~l~~v~~~~d~~~~a~G-~~-G~v~~s~-D~G~tW~~~~~~~~~~~ 371 (398)
T PLN00033 314 EDF-------------------DFEEADIKSRGFGILDVGYRSKKEAWAAG-GS-GILLRST-DGGKSWKRDKGADNIAA 371 (398)
T ss_pred ccc-------------------ceeecccCCCCcceEEEEEcCCCcEEEEE-CC-CcEEEeC-CCCcceeEccccCCCCc
Confidence 000 01111111 12358899999887766554 55 5665553 33433 2222 1235
Q ss_pred CeEEEEEcCCCCEEEEEecCCeEEEE
Q 018806 256 GLSILKWSPTGDYFFAAKFDGTFYLW 281 (350)
Q Consensus 256 ~v~~~~~sp~g~~l~~~~~d~~v~iw 281 (350)
..+.+.|.++++.+++| .+|.|--|
T Consensus 372 ~ly~v~f~~~~~g~~~G-~~G~il~~ 396 (398)
T PLN00033 372 NLYSVKFFDDKKGFVLG-NDGVLLRY 396 (398)
T ss_pred ceeEEEEcCCCceEEEe-CCcEEEEe
Confidence 68899998877766665 46766443
No 441
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=90.53 E-value=0.38 Score=46.27 Aligned_cols=71 Identities=15% Similarity=0.167 Sum_probs=47.3
Q ss_pred CeeEEEEec---CCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEE-----------EeeCCCeEEEEecCC
Q 018806 101 DLQGVSWHQ---HKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLE-----------WRPNGGRSLSVGCKG 166 (350)
Q Consensus 101 ~V~~v~~sp---~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~-----------~sp~~~~l~~~~~d~ 166 (350)
++.-|.|.| +.-++.++-.++++++.+++... ..++.+|...+..++ .||||..++....||
T Consensus 182 ~~~~V~wcp~~~~~~~ic~~~~~~~i~lL~~~ra~----~~l~rsHs~~~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG 257 (1283)
T KOG1916|consen 182 DPQLVSWCPIAVNKVYICYGLKGGEIRLLNINRAL----RSLFRSHSQRVTDMAFFAEGVLKLASLSPDGTVFAWAISDG 257 (1283)
T ss_pred CcceeeecccccccceeeeccCCCceeEeeechHH----HHHHHhcCCCcccHHHHhhchhhheeeCCCCcEEEEeecCC
Confidence 345555554 55677777788999988875321 133335666555544 488888888888888
Q ss_pred cEEEEecCC
Q 018806 167 GICIWAPSY 175 (350)
Q Consensus 167 ~v~iwd~~~ 175 (350)
.++.|.+-.
T Consensus 258 ~v~f~Qiyi 266 (1283)
T KOG1916|consen 258 SVGFYQIYI 266 (1283)
T ss_pred ccceeeeee
Confidence 888887653
No 442
>PF11635 Med16: Mediator complex subunit 16; InterPro: IPR021665 Mediator is a large complex of up to 33 proteins that is conserved from plants through fungi to humans - the number and representation of individual subunits varying with species [],[]. It is arranged into four different sections, a core, a head, a tail and a kinase-activity part, and the number of subunits within each of these is what varies with species. Overall, Mediator regulates the transcriptional activity of RNA polymerase II but it would appear that each of the four different sections has a slightly different function. Med16 is one of the subunits of the Tail portion of the Mediator complex and is required for lipopolysaccharide gene-expression []. Several members including the human protein, Q9Y2X0 from SWISSPROT, have one or more WD40 domains on them, PF00400 from PFAM.
Probab=90.03 E-value=21 Score=35.26 Aligned_cols=76 Identities=13% Similarity=-0.007 Sum_probs=52.6
Q ss_pred eEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeee----e----------------cCCCeEEE
Q 018806 201 WTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIR----R----------------GFGGLSIL 260 (350)
Q Consensus 201 ~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~----~----------------~~~~v~~~ 260 (350)
|.....+.-+ +.|.++....-+..++.+..| |+|.++|..+.+..... . ....+..+
T Consensus 250 l~~~~~i~~~--~~V~si~~~~~~~~v~~~~~D-GsI~~~dr~t~~~~~~~~~~~~~~~~v~s~~~~Gf~fp~~~~~~~v 326 (753)
T PF11635_consen 250 LRRLDDITLN--KRVVSITSPELDIVVAFAFSD-GSIEFRDRNTMKELNETRTNGEPPNTVTSLFQAGFHFPCIQPPLHV 326 (753)
T ss_pred EEEecccccC--CeEEEEEecccCcEEEEEEcC-CeEEEEecCcchhhcccccccCCccccccccccccccccCCCCceE
Confidence 4444444433 588999988888889998888 79999998776432111 0 01123457
Q ss_pred EEcCCCCEEEEEecCCeEE
Q 018806 261 KWSPTGDYFFAAKFDGTFY 279 (350)
Q Consensus 261 ~~sp~g~~l~~~~~d~~v~ 279 (350)
+|||.+.-++.-..++.+.
T Consensus 327 afSPt~c~~v~~~~~~~~~ 345 (753)
T PF11635_consen 327 AFSPTMCSLVQIDEDGKTK 345 (753)
T ss_pred EECcccceEEEEecCCCce
Confidence 8999999888888888755
No 443
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=89.65 E-value=9.4 Score=30.70 Aligned_cols=102 Identities=15% Similarity=0.129 Sum_probs=63.9
Q ss_pred CeEEEEEeCCCeEEEEeCCCCCce--eeeecCCCeEEEEEcCCCCEEEEEecC---C---eEEEE-eCCCC----ce--e
Q 018806 225 RYLASASYESSSFTIWDVAQGLGT--PIRRGFGGLSILKWSPTGDYFFAAKFD---G---TFYLW-ETNTW----TS--E 289 (350)
Q Consensus 225 ~~l~~~~~d~g~i~iwd~~~~~~~--~~~~~~~~v~~~~~sp~g~~l~~~~~d---~---~v~iw-d~~~~----~~--~ 289 (350)
..|..+... ..|.+|++...... ..+..-+.|..+.++..|.+|++--.+ . .+|+| |.+.. +. .
T Consensus 29 d~Lfva~~g-~~Vev~~l~~~~~~~~~~F~Tv~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~NWr~~~~~~~~v~v 107 (215)
T PF14761_consen 29 DALFVAASG-CKVEVYDLEQEECPLLCTFSTVGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFNWRSQKEENSPVRV 107 (215)
T ss_pred ceEEEEcCC-CEEEEEEcccCCCceeEEEcchhheeEEEeccccceEEEEEeecCCccceEEEEEEEhhhhcccCCcEEE
Confidence 444444445 48999999844433 344456889999999999999987432 2 55665 22211 11 1
Q ss_pred cccc---------------------CCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeCC
Q 018806 290 PWSS---------------------TSGFVTGATWDPEGRMILLAFAGSLTLGSIHFAS 327 (350)
Q Consensus 290 ~~~~---------------------~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~~ 327 (350)
++.+ -...+.+++-.|-.--|++|+++...+|.+....
T Consensus 108 RiaG~~v~~~~~~~~~~qleiiElPl~~~p~ciaCC~~tG~LlVg~~~~l~lf~l~~~~ 166 (215)
T PF14761_consen 108 RIAGHRVTPSFNESSKDQLEIIELPLSEPPLCIACCPVTGNLLVGCGNKLVLFTLKYQT 166 (215)
T ss_pred EEcccccccCCCCccccceEEEEecCCCCCCEEEecCCCCCEEEEcCCEEEEEEEEEEE
Confidence 1111 2345677888886556667888888888876643
No 444
>COG4590 ABC-type uncharacterized transport system, permease component [General function prediction only]
Probab=89.61 E-value=0.59 Score=41.49 Aligned_cols=159 Identities=14% Similarity=0.104 Sum_probs=84.4
Q ss_pred CCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCC-ceeecccccccceecCCCCCceEEeeeccCCCCCcee-eEEE
Q 018806 143 SQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNA-ASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQIT-ALSW 220 (350)
Q Consensus 143 ~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~-~~~~ 220 (350)
....|..+-..|||+.+..-. ..++.++++...... .++... -.+.....|+ .+..
T Consensus 219 ~~~~v~qllL~Pdg~~LYv~~-g~~~~v~~L~~r~l~~rkl~~d---------------------spg~~~~~Vte~l~l 276 (733)
T COG4590 219 PFSDVSQLLLTPDGKTLYVRT-GSELVVALLDKRSLQIRKLVDD---------------------SPGDSRHQVTEQLYL 276 (733)
T ss_pred CccchHhhEECCCCCEEEEec-CCeEEEEeecccccchhhhhhc---------------------CCCchHHHHHHHHHH
Confidence 345678888999976555444 478888888733211 111000 0110001222 2222
Q ss_pred CCCCCeEEEEEeCCCeEEEE-eCCCCCceee---eec---CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceecccc
Q 018806 221 GPDGRYLASASYESSSFTIW-DVAQGLGTPI---RRG---FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSS 293 (350)
Q Consensus 221 sp~g~~l~~~~~d~g~i~iw-d~~~~~~~~~---~~~---~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~ 293 (350)
-..|..+.....| |-|.-| |++.+....+ ... ...+..+.=..+.+-+++-..+|++.++.....+..-...
T Consensus 277 L~Gg~SLLv~~~d-G~vsQWFdvr~~~~p~l~h~R~f~l~pa~~~~l~pe~~rkgF~~l~~~G~L~~f~st~~~~lL~~~ 355 (733)
T COG4590 277 LSGGFSLLVVHED-GLVSQWFDVRRDGQPHLNHIRNFKLAPAEVQFLLPETNRKGFYSLYRNGTLQSFYSTSEKLLLFER 355 (733)
T ss_pred HhCceeEEEEcCC-CceeeeeeeecCCCCcceeeeccccCcccceeeccccccceEEEEcCCCceeeeecccCcceehhh
Confidence 2346677778888 576666 6554432211 111 1222222212233446666778888877655544432222
Q ss_pred CCCCeEEEEEcCCCCEEEEEECCCeEEEEEE
Q 018806 294 TSGFVTGATWDPEGRMILLAFAGSLTLGSIH 324 (350)
Q Consensus 294 ~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~ 324 (350)
.-..+.-+++||++.+|++-..+.+.++.++
T Consensus 356 ~~~~~~~~~~Sp~~~~Ll~e~~gki~~~~l~ 386 (733)
T COG4590 356 AYQAPQLVAMSPNQAYLLSEDQGKIRLAQLE 386 (733)
T ss_pred hhcCcceeeeCcccchheeecCCceEEEEec
Confidence 3335677899999999987655555655554
No 445
>KOG1520 consensus Predicted alkaloid synthase/Surface mucin Hemomucin [General function prediction only]
Probab=89.49 E-value=14 Score=32.46 Aligned_cols=81 Identities=14% Similarity=0.183 Sum_probs=52.0
Q ss_pred CCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec-CCeEEEEeCCCCce---ecccc-CCCCeEEEEEcCCC
Q 018806 233 ESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF-DGTFYLWETNTWTS---EPWSS-TSGFVTGATWDPEG 307 (350)
Q Consensus 233 d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~-d~~v~iwd~~~~~~---~~~~~-~~~~v~~~~~s~~g 307 (350)
..|.+.-||..+.....+...-.-...++.|||+.+++.+-. -..|+-|=++..+. ..+.. -.+..-.+..+++|
T Consensus 197 ~~GRl~~YD~~tK~~~VLld~L~F~NGlaLS~d~sfvl~~Et~~~ri~rywi~g~k~gt~EvFa~~LPG~PDNIR~~~~G 276 (376)
T KOG1520|consen 197 PTGRLFRYDPSTKVTKVLLDGLYFPNGLALSPDGSFVLVAETTTARIKRYWIKGPKAGTSEVFAEGLPGYPDNIRRDSTG 276 (376)
T ss_pred CccceEEecCcccchhhhhhcccccccccCCCCCCEEEEEeeccceeeeeEecCCccCchhhHhhcCCCCCcceeECCCC
Confidence 347888899888776666666667778999999999887743 22343333444333 22222 34455567788999
Q ss_pred CEEEEE
Q 018806 308 RMILLA 313 (350)
Q Consensus 308 ~~l~~~ 313 (350)
.+-+.-
T Consensus 277 ~fWVal 282 (376)
T KOG1520|consen 277 HFWVAL 282 (376)
T ss_pred CEEEEE
Confidence 665543
No 446
>PHA03098 kelch-like protein; Provisional
Probab=89.36 E-value=12 Score=35.18 Aligned_cols=66 Identities=9% Similarity=0.043 Sum_probs=35.9
Q ss_pred CCCeEEEEEeCC-------CeEEEEeCCCCCceeeeecC---CCeEEEEEcCCCCEEEEEecC-----CeEEEEeCCCCc
Q 018806 223 DGRYLASASYES-------SSFTIWDVAQGLGTPIRRGF---GGLSILKWSPTGDYFFAAKFD-----GTFYLWETNTWT 287 (350)
Q Consensus 223 ~g~~l~~~~~d~-------g~i~iwd~~~~~~~~~~~~~---~~v~~~~~sp~g~~l~~~~~d-----~~v~iwd~~~~~ 287 (350)
+++.++.|+... ..+.+||..+.+...+.... .....+.+ +++.++.|+.+ +.|.+||.++.+
T Consensus 437 ~~~iyv~GG~~~~~~~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~--~~~iyv~GG~~~~~~~~~v~~yd~~~~~ 514 (534)
T PHA03098 437 DGKIYVIGGISYIDNIKVYNIVESYNPVTNKWTELSSLNFPRINASLCIF--NNKIYVVGGDKYEYYINEIEVYDDKTNT 514 (534)
T ss_pred CCEEEEECCccCCCCCcccceEEEecCCCCceeeCCCCCcccccceEEEE--CCEEEEEcCCcCCcccceeEEEeCCCCE
Confidence 455666665321 14888998877654432111 11112222 66666666653 467888887765
Q ss_pred eec
Q 018806 288 SEP 290 (350)
Q Consensus 288 ~~~ 290 (350)
-..
T Consensus 515 W~~ 517 (534)
T PHA03098 515 WTL 517 (534)
T ss_pred EEe
Confidence 433
No 447
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=89.26 E-value=20 Score=34.02 Aligned_cols=103 Identities=14% Similarity=0.164 Sum_probs=55.6
Q ss_pred CCCeEEEEEeCC-----CeEEEEeCCCCCceeeee---cCCCeEEEEEcCCCCEEEEEecCC-----eEEEEeCCCCcee
Q 018806 223 DGRYLASASYES-----SSFTIWDVAQGLGTPIRR---GFGGLSILKWSPTGDYFFAAKFDG-----TFYLWETNTWTSE 289 (350)
Q Consensus 223 ~g~~l~~~~~d~-----g~i~iwd~~~~~~~~~~~---~~~~v~~~~~sp~g~~l~~~~~d~-----~v~iwd~~~~~~~ 289 (350)
+|+..++|+.+. .++..||..+.....+.. ...... ++ .-++.+.+.|+.|+ +|..||..+.+-.
T Consensus 427 ~g~iYi~GG~~~~~~~l~sve~YDP~t~~W~~~~~M~~~R~~~g-~a-~~~~~iYvvGG~~~~~~~~~VE~ydp~~~~W~ 504 (571)
T KOG4441|consen 427 GGKLYIIGGGDGSSNCLNSVECYDPETNTWTLIAPMNTRRSGFG-VA-VLNGKIYVVGGFDGTSALSSVERYDPETNQWT 504 (571)
T ss_pred CCEEEEEcCcCCCccccceEEEEcCCCCceeecCCcccccccce-EE-EECCEEEEECCccCCCccceEEEEcCCCCcee
Confidence 567777776442 167889988876543322 112222 22 22666777887765 4788999887765
Q ss_pred ccccCCCCeEEEEE-cCCCCEEEEEE-CCCeEEEEEEeCC
Q 018806 290 PWSSTSGFVTGATW-DPEGRMILLAF-AGSLTLGSIHFAS 327 (350)
Q Consensus 290 ~~~~~~~~v~~~~~-s~~g~~l~~~~-~~~~~~~~~~~~~ 327 (350)
.+..-......+.. .-+++..++|+ ++...+..+..++
T Consensus 505 ~v~~m~~~rs~~g~~~~~~~ly~vGG~~~~~~l~~ve~yd 544 (571)
T KOG4441|consen 505 MVAPMTSPRSAVGVVVLGGKLYAVGGFDGNNNLNTVECYD 544 (571)
T ss_pred EcccCccccccccEEEECCEEEEEecccCccccceeEEcC
Confidence 44322222222211 22345555555 5555555665553
No 448
>PHA02713 hypothetical protein; Provisional
Probab=89.25 E-value=20 Score=33.97 Aligned_cols=77 Identities=13% Similarity=0.149 Sum_probs=37.9
Q ss_pred eEEEEeCCCCCceeeeecC-CCeEEEEEcCCCCEEEEEecC------CeEEEEeCCC-Cceeccc---cCCCCeEEEEEc
Q 018806 236 SFTIWDVAQGLGTPIRRGF-GGLSILKWSPTGDYFFAAKFD------GTFYLWETNT-WTSEPWS---STSGFVTGATWD 304 (350)
Q Consensus 236 ~i~iwd~~~~~~~~~~~~~-~~v~~~~~sp~g~~l~~~~~d------~~v~iwd~~~-~~~~~~~---~~~~~v~~~~~s 304 (350)
.+..||..+.+...+..-. .........-+|++.+.|+.+ ..+..||.++ .+-.... ........++
T Consensus 433 ~ve~YDP~td~W~~v~~m~~~r~~~~~~~~~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~~~-- 510 (557)
T PHA02713 433 KVIRYDTVNNIWETLPNFWTGTIRPGVVSHKDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTESRLSALHTIL-- 510 (557)
T ss_pred eEEEECCCCCeEeecCCCCcccccCcEEEECCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCcccccceeEE--
Confidence 5778888776543322111 111111122356666667643 2467899887 4543222 1111222222
Q ss_pred CCCCEEEEEE
Q 018806 305 PEGRMILLAF 314 (350)
Q Consensus 305 ~~g~~l~~~~ 314 (350)
-+|+..++|+
T Consensus 511 ~~~~iyv~Gg 520 (557)
T PHA02713 511 HDNTIMMLHC 520 (557)
T ss_pred ECCEEEEEee
Confidence 2567777776
No 449
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=88.97 E-value=9.4 Score=34.39 Aligned_cols=74 Identities=18% Similarity=0.343 Sum_probs=46.9
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEE----cCC----------------CCEE-EE
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKW----SPT----------------GDYF-FA 271 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~----sp~----------------g~~l-~~ 271 (350)
..+.++..+|++++.++...- |.|.++|+.++....+-++-.... +.| ... ..+| +.
T Consensus 308 R~~~~i~~sP~~~laA~tDsl-GRV~LiD~~~~~vvrmWKGYRdAq-c~wi~~~~~~~~~~~~~~~~~~~~~~~l~LvIy 385 (415)
T PF14655_consen 308 REGESICLSPSGRLAAVTDSL-GRVLLIDVARGIVVRMWKGYRDAQ-CGWIEVPEEGDRDRSNSNSPKSSSRFALFLVIY 385 (415)
T ss_pred ceEEEEEECCCCCEEEEEcCC-CcEEEEECCCChhhhhhccCccce-EEEEEeecccccccccccccCCCCcceEEEEEE
Confidence 468899999998877775444 899999999886554433221110 111 000 1122 45
Q ss_pred EecCCeEEEEeCCCCce
Q 018806 272 AKFDGTFYLWETNTWTS 288 (350)
Q Consensus 272 ~~~d~~v~iwd~~~~~~ 288 (350)
+-..|.|.||.+++|..
T Consensus 386 aprRg~lEvW~~~~g~R 402 (415)
T PF14655_consen 386 APRRGILEVWSMRQGPR 402 (415)
T ss_pred eccCCeEEEEecCCCCE
Confidence 56678999999988765
No 450
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=87.70 E-value=7.3 Score=35.64 Aligned_cols=74 Identities=14% Similarity=0.156 Sum_probs=49.4
Q ss_pred ceeeEEECCCCCeEEEEEeCCCeEEEEe---------CCCCCce----------eeeec--CCCeEEEEEcCCC---CEE
Q 018806 214 QITALSWGPDGRYLASASYESSSFTIWD---------VAQGLGT----------PIRRG--FGGLSILKWSPTG---DYF 269 (350)
Q Consensus 214 ~v~~~~~sp~g~~l~~~~~d~g~i~iwd---------~~~~~~~----------~~~~~--~~~v~~~~~sp~g---~~l 269 (350)
.|..+..++.|..++.++.+ |.+.++= ++.++.. .++.. .-.+..++|+|+. ..|
T Consensus 105 eV~~vl~s~~GS~VaL~G~~-Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss~~ltl~Qa~WHP~S~~D~hL 183 (741)
T KOG4460|consen 105 EVYQVLLSPTGSHVALIGIK-GLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSSTSLTLKQAAWHPSSILDPHL 183 (741)
T ss_pred EEEEEEecCCCceEEEecCC-eeEEEEchhhcCccceecCCCceEEEEeecccceeeccCCceeeeeccccCCccCCceE
Confidence 56788899999999998888 5555442 1122211 11111 1235678999975 567
Q ss_pred EEEecCCeEEEEeCCCCce
Q 018806 270 FAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 270 ~~~~~d~~v~iwd~~~~~~ 288 (350)
..-..|.+|++||+...+.
T Consensus 184 ~iL~sdnviRiy~lS~~te 202 (741)
T KOG4460|consen 184 VLLTSDNVIRIYSLSEPTE 202 (741)
T ss_pred EEEecCcEEEEEecCCcch
Confidence 7778899999999976544
No 451
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=87.68 E-value=21 Score=32.18 Aligned_cols=101 Identities=12% Similarity=0.127 Sum_probs=61.7
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCce---eeee-----cCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 212 GEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGT---PIRR-----GFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~---~~~~-----~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
...+.++.|.+++..++++ .. |.+ ++....++.- .+.. ....+..+.|.+++..+++| .+|.+....
T Consensus 280 ~~~l~~v~~~~dg~l~l~g-~~-G~l-~~S~d~G~~~~~~~f~~~~~~~~~~~l~~v~~~~d~~~~a~G-~~G~v~~s~- 354 (398)
T PLN00033 280 ARRIQNMGWRADGGLWLLT-RG-GGL-YVSKGTGLTEEDFDFEEADIKSRGFGILDVGYRSKKEAWAAG-GSGILLRST- 354 (398)
T ss_pred ccceeeeeEcCCCCEEEEe-CC-ceE-EEecCCCCcccccceeecccCCCCcceEEEEEcCCCcEEEEE-CCCcEEEeC-
Confidence 3578999999998887765 44 454 3344444311 1111 12358889999888766555 567665553
Q ss_pred CCCce-ecc---ccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 284 NTWTS-EPW---SSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 284 ~~~~~-~~~---~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
+.++. ... ..-....+.+.|.++++.++++.++.
T Consensus 355 D~G~tW~~~~~~~~~~~~ly~v~f~~~~~g~~~G~~G~ 392 (398)
T PLN00033 355 DGGKSWKRDKGADNIAANLYSVKFFDDKKGFVLGNDGV 392 (398)
T ss_pred CCCcceeEccccCCCCcceeEEEEcCCCceEEEeCCcE
Confidence 44443 222 12345688999988888888775443
No 452
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=87.46 E-value=6.2 Score=30.76 Aligned_cols=30 Identities=20% Similarity=0.393 Sum_probs=24.1
Q ss_pred CeEEEEEcCCC------CEEEEEecCCeEEEEeCCC
Q 018806 256 GLSILKWSPTG------DYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 256 ~v~~~~~sp~g------~~l~~~~~d~~v~iwd~~~ 285 (350)
.+..++|||.| -.|++...++.|.||.-..
T Consensus 87 ~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~ 122 (173)
T PF12657_consen 87 QVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPG 122 (173)
T ss_pred cEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCC
Confidence 67889999954 3578888999999997664
No 453
>PHA03098 kelch-like protein; Provisional
Probab=87.21 E-value=27 Score=32.93 Aligned_cols=90 Identities=4% Similarity=-0.114 Sum_probs=45.3
Q ss_pred CCCeEEEEEeCC-----CeEEEEeCCCCCceeeeecCCC-eEEEEEcCCCCEEEEEecC--------CeEEEEeCCCCce
Q 018806 223 DGRYLASASYES-----SSFTIWDVAQGLGTPIRRGFGG-LSILKWSPTGDYFFAAKFD--------GTFYLWETNTWTS 288 (350)
Q Consensus 223 ~g~~l~~~~~d~-----g~i~iwd~~~~~~~~~~~~~~~-v~~~~~sp~g~~l~~~~~d--------~~v~iwd~~~~~~ 288 (350)
+++.++.|+... ..+..||..+.+.........+ ....+...+++..+.|+.+ ..+.+||..+.+-
T Consensus 389 ~~~iYv~GG~~~~~~~~~~v~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~iyv~GG~~~~~~~~~~~~v~~yd~~~~~W 468 (534)
T PHA03098 389 NNLIYVIGGISKNDELLKTVECFSLNTNKWSKGSPLPISHYGGCAIYHDGKIYVIGGISYIDNIKVYNIVESYNPVTNKW 468 (534)
T ss_pred CCEEEEECCcCCCCcccceEEEEeCCCCeeeecCCCCccccCceEEEECCEEEEECCccCCCCCcccceEEEecCCCCce
Confidence 566666666321 2688899887654432221111 1111222356666666542 2388999988765
Q ss_pred eccccC---CCCeEEEEEcCCCCEEEEEE
Q 018806 289 EPWSST---SGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 289 ~~~~~~---~~~v~~~~~s~~g~~l~~~~ 314 (350)
..+... ......+. -+++.+++|+
T Consensus 469 ~~~~~~~~~r~~~~~~~--~~~~iyv~GG 495 (534)
T PHA03098 469 TELSSLNFPRINASLCI--FNNKIYVVGG 495 (534)
T ss_pred eeCCCCCcccccceEEE--ECCEEEEEcC
Confidence 433211 11112222 2667766665
No 454
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=87.19 E-value=8.3 Score=34.74 Aligned_cols=30 Identities=10% Similarity=0.165 Sum_probs=26.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYED 130 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~ 130 (350)
.+.++..+|++++.|+...-|.|.++|+..
T Consensus 309 ~~~~i~~sP~~~laA~tDslGRV~LiD~~~ 338 (415)
T PF14655_consen 309 EGESICLSPSGRLAAVTDSLGRVLLIDVAR 338 (415)
T ss_pred eEEEEEECCCCCEEEEEcCCCcEEEEECCC
Confidence 589999999999999887889999999853
No 455
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=87.17 E-value=9.7 Score=29.66 Aligned_cols=31 Identities=23% Similarity=0.580 Sum_probs=22.8
Q ss_pred CceeeEEECCCC-----C-eEEEEEeCCCeEEEEeCCC
Q 018806 213 EQITALSWGPDG-----R-YLASASYESSSFTIWDVAQ 244 (350)
Q Consensus 213 ~~v~~~~~sp~g-----~-~l~~~~~d~g~i~iwd~~~ 244 (350)
..+.+++|||.| + .|++.+.+ |.|.+|.-..
T Consensus 86 ~~vv~~aWSP~Gl~~~~rClLavLTs~-~~l~l~~~~~ 122 (173)
T PF12657_consen 86 SQVVSAAWSPSGLGPNGRCLLAVLTSN-GRLSLYGPPG 122 (173)
T ss_pred ccEEEEEECCCCCCCCCceEEEEEcCC-CeEEEEecCC
Confidence 478999999954 3 35666666 7999998653
No 456
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=87.11 E-value=15 Score=30.01 Aligned_cols=99 Identities=12% Similarity=0.099 Sum_probs=64.7
Q ss_pred eeEEECCCCCeEEEEEeCCCeEEEEe--CCCCCce---eee---e----cCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 216 TALSWGPDGRYLASASYESSSFTIWD--VAQGLGT---PIR---R----GFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 216 ~~~~~sp~g~~l~~~~~d~g~i~iwd--~~~~~~~---~~~---~----~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
..++|+.+.+.++.....+-+|.-|| ..+|... .+. . ..-..-.++...+|.+.++.-..++|...|.
T Consensus 161 Ngl~Wd~d~K~fY~iDsln~~V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~eG~L~Va~~ng~~V~~~dp 240 (310)
T KOG4499|consen 161 NGLAWDSDAKKFYYIDSLNYEVDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDTEGNLYVATFNGGTVQKVDP 240 (310)
T ss_pred ccccccccCcEEEEEccCceEEeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEccCCcEEEEEecCcEEEEECC
Confidence 46889988887776544334776677 5565321 111 1 1112334666778888888888899999999
Q ss_pred CCCcee-ccccCCCCeEEEEEcC-CCCEEEEEE
Q 018806 284 NTWTSE-PWSSTSGFVTGATWDP-EGRMILLAF 314 (350)
Q Consensus 284 ~~~~~~-~~~~~~~~v~~~~~s~-~g~~l~~~~ 314 (350)
.+|+.. .+.-....+++++|-- +-..+++++
T Consensus 241 ~tGK~L~eiklPt~qitsccFgGkn~d~~yvT~ 273 (310)
T KOG4499|consen 241 TTGKILLEIKLPTPQITSCCFGGKNLDILYVTT 273 (310)
T ss_pred CCCcEEEEEEcCCCceEEEEecCCCccEEEEEe
Confidence 999984 4444577899999964 334455544
No 457
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=86.99 E-value=19 Score=30.96 Aligned_cols=87 Identities=15% Similarity=0.091 Sum_probs=57.7
Q ss_pred eEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEec----C----------------C
Q 018806 217 ALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKF----D----------------G 276 (350)
Q Consensus 217 ~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~----d----------------~ 276 (350)
+..|. +|+..++-+.. |.+.-+|.++|+...+..-.+....++|. |.+++++.. + .
T Consensus 207 SPRWh-dgrLwvldsgt-Gev~~vD~~~G~~e~Va~vpG~~rGL~f~--G~llvVgmSk~R~~~~f~glpl~~~l~~~~C 282 (335)
T TIGR03032 207 SPRWY-QGKLWLLNSGR-GELGYVDPQAGKFQPVAFLPGFTRGLAFA--GDFAFVGLSKLRESRVFGGLPIEERLDALGC 282 (335)
T ss_pred CCcEe-CCeEEEEECCC-CEEEEEcCCCCcEEEEEECCCCCccccee--CCEEEEEeccccCCCCcCCCchhhhhhhhcc
Confidence 33443 56666766667 79999999989888777777888899998 888776532 1 2
Q ss_pred eEEEEeCCCCceec---cccCCCCeEEEEEcCCC
Q 018806 277 TFYLWETNTWTSEP---WSSTSGFVTGATWDPEG 307 (350)
Q Consensus 277 ~v~iwd~~~~~~~~---~~~~~~~v~~~~~s~~g 307 (350)
-|.+.|+++|.... +.+.-..+.+++.-|.-
T Consensus 283 Gv~vidl~tG~vv~~l~feg~v~EifdV~vLPg~ 316 (335)
T TIGR03032 283 GVAVIDLNSGDVVHWLRFEGVIEEIYDVAVLPGV 316 (335)
T ss_pred cEEEEECCCCCEEEEEEeCCceeEEEEEEEecCC
Confidence 36666777777532 33333445566666643
No 458
>PRK13615 lipoprotein LpqB; Provisional
Probab=86.55 E-value=29 Score=32.74 Aligned_cols=156 Identities=12% Similarity=0.047 Sum_probs=91.0
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAA 180 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~ 180 (350)
...+++.++++..+|....++.+.++... +.. ..+. ....++...|.++| .+-++......++......+...
T Consensus 335 ~~~s~avS~dg~~~A~v~~~~~l~vg~~~---~~~-~~~~--~~~~Lt~PS~d~~g-~vWtv~~g~~~~l~~~~~~G~~~ 407 (557)
T PRK13615 335 QADAATLSADGRQAAVRNASGVWSVGDGD---RDA-VLLD--TRPGLVAPSLDAQG-YVWSTPASDPRGLVAWGPDGVGH 407 (557)
T ss_pred ccccceEcCCCceEEEEcCCceEEEecCC---Ccc-eeec--cCCccccCcCcCCC-CEEEEeCCCceEEEEecCCCceE
Confidence 34788999999999988777877777653 121 2222 23357888888885 44444433334554443222221
Q ss_pred eeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeC--CCeEEEEeC--CCCCceee------
Q 018806 181 SVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYE--SSSFTIWDV--AQGLGTPI------ 250 (350)
Q Consensus 181 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d--~g~i~iwd~--~~~~~~~~------ 250 (350)
.+. ......+.|..+..|+||-.++.-... .++|.+=-+ ..+....+
T Consensus 408 ~v~-----------------------v~~~~~~~I~~lrvSrDG~R~Avi~~~~g~~~V~va~V~R~~~~P~~L~~~p~~ 464 (557)
T PRK13615 408 PVA-----------------------VSWTATGRVVSLEVARDGARVLVQLETGAGPQLLVASIVRDGGVPTSLTTTPLE 464 (557)
T ss_pred Eee-----------------------ccccCCCeeEEEEeCCCccEEEEEEecCCCCEEEEEEEEeCCCcceEeeeccEE
Confidence 111 111123589999999999988775431 135555322 22212222
Q ss_pred -eecCCCeEEEEEcCCCCEEEEE---ecCCeEEEEeCCCC
Q 018806 251 -RRGFGGLSILKWSPTGDYFFAA---KFDGTFYLWETNTW 286 (350)
Q Consensus 251 -~~~~~~v~~~~~sp~g~~l~~~---~~d~~v~iwd~~~~ 286 (350)
......+.++.|..++.+++.+ +.+..+++..+...
T Consensus 465 l~~~l~~v~sl~W~~~~~laVl~~~~~~~~~v~~v~v~g~ 504 (557)
T PRK13615 465 LLASPGTPLDATWVDELDVATLTLAPDGERQVELHQVGGP 504 (557)
T ss_pred cccCcCcceeeEEcCCCEEEEEeccCCCCceEEEEECCCc
Confidence 1123478899999999876655 23457788887744
No 459
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=86.42 E-value=20 Score=31.25 Aligned_cols=101 Identities=17% Similarity=0.312 Sum_probs=63.3
Q ss_pred CCceeeEEECCCCCeEEEEEeCCCe------EEEEeCCC--CC--c------eeeeecCC--------CeEEEEEcCCCC
Q 018806 212 GEQITALSWGPDGRYLASASYESSS------FTIWDVAQ--GL--G------TPIRRGFG--------GLSILKWSPTGD 267 (350)
Q Consensus 212 ~~~v~~~~~sp~g~~l~~~~~d~g~------i~iwd~~~--~~--~------~~~~~~~~--------~v~~~~~sp~g~ 267 (350)
-+.+..+.+.+++..+++.+.+ |. +..+++.. +. . ..+....+ ..-++++.++|.
T Consensus 19 ~GGlSgl~~~~~~~~~~avSD~-g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~ 97 (326)
T PF13449_consen 19 FGGLSGLDYDPDDGRFYAVSDR-GPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGS 97 (326)
T ss_pred cCcEeeEEEeCCCCEEEEEECC-CCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCC
Confidence 3678899999765566666666 56 65555543 11 1 11111122 233688878888
Q ss_pred EEEEEecC------CeEEEEeCCCCce-ecc---------------ccCCCCeEEEEEcCCCCEEEEEE
Q 018806 268 YFFAAKFD------GTFYLWETNTWTS-EPW---------------SSTSGFVTGATWDPEGRMILLAF 314 (350)
Q Consensus 268 ~l~~~~~d------~~v~iwd~~~~~~-~~~---------------~~~~~~v~~~~~s~~g~~l~~~~ 314 (350)
++++.-.+ ..|+.++.. |+. ..+ .......-+++++|+|+.|+++.
T Consensus 98 ~~is~E~~~~~~~~p~I~~~~~~-G~~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~ 165 (326)
T PF13449_consen 98 FWISSEGGRTGGIPPRIRRFDLD-GRVIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAM 165 (326)
T ss_pred EEEEeCCccCCCCCCEEEEECCC-CcccceEccccccccccCccccccCCCCeEEEEECCCCCEEEEEE
Confidence 88777667 788888876 443 111 12345678999999999777664
No 460
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=85.62 E-value=7.5 Score=35.55 Aligned_cols=81 Identities=20% Similarity=0.270 Sum_probs=54.4
Q ss_pred CccCeeEEEEecCCCEEEEEECCCeEEEEEccC--------CCCC--ceeEec--------CCCCCCeeEEEEeeCC---
Q 018806 98 PEVDLQGVSWHQHKHIVAFISGSTQVIVRDYED--------SEGK--DACILT--------SDSQRDVKVLEWRPNG--- 156 (350)
Q Consensus 98 ~~~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~--------~~~~--~~~~~~--------~~~~~~v~~~~~sp~~--- 156 (350)
..+.|..+..|+.|..+|.++.+|.+.+ .+.. .+++ ..+..+ ....-.+..++|+|+.
T Consensus 102 V~feV~~vl~s~~GS~VaL~G~~Gi~vM-eLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss~~ltl~Qa~WHP~S~~D 180 (741)
T KOG4460|consen 102 VLFEVYQVLLSPTGSHVALIGIKGLMVM-ELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSSTSLTLKQAAWHPSSILD 180 (741)
T ss_pred ceEEEEEEEecCCCceEEEecCCeeEEE-EchhhcCccceecCCCceEEEEeecccceeeccCCceeeeeccccCCccCC
Confidence 3568999999999999999999985543 3310 1121 112111 1112246778999974
Q ss_pred CeEEEEecCCcEEEEecCCCCCC
Q 018806 157 GRSLSVGCKGGICIWAPSYPGNA 179 (350)
Q Consensus 157 ~~l~~~~~d~~v~iwd~~~~~~~ 179 (350)
.+++.-.+|+.+++||+......
T Consensus 181 ~hL~iL~sdnviRiy~lS~~tel 203 (741)
T KOG4460|consen 181 PHLVLLTSDNVIRIYSLSEPTEL 203 (741)
T ss_pred ceEEEEecCcEEEEEecCCcchh
Confidence 57888899999999999855543
No 461
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=85.47 E-value=13 Score=27.50 Aligned_cols=93 Identities=9% Similarity=0.094 Sum_probs=57.3
Q ss_pred EECCCCCeEEEEEeCCCeEEEEeCCCCC--------ceeeeecCCCeEEEE---EcCC--CCEEEEEecCCeEEEEeCCC
Q 018806 219 SWGPDGRYLASASYESSSFTIWDVAQGL--------GTPIRRGFGGLSILK---WSPT--GDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 219 ~~sp~g~~l~~~~~d~g~i~iwd~~~~~--------~~~~~~~~~~v~~~~---~sp~--g~~l~~~~~d~~v~iwd~~~ 285 (350)
.|......|++++.- |+|.|++..... ...+..-...|++++ |.|+ ...|+.|+ ...+-.||+..
T Consensus 5 kfDG~~pcL~~aT~~-gKV~IH~ph~~~~~~~~~~~~i~~LNin~~italaaG~l~~~~~~D~LliGt-~t~llaYDV~~ 82 (136)
T PF14781_consen 5 KFDGVHPCLACATTG-GKVFIHNPHERGQRTGRQDSDISFLNINQEITALAAGRLKPDDGRDCLLIGT-QTSLLAYDVEN 82 (136)
T ss_pred EeCCCceeEEEEecC-CEEEEECCCccccccccccCceeEEECCCceEEEEEEecCCCCCcCEEEEec-cceEEEEEccc
Confidence 455555678888877 699999866432 234445556777775 4332 33455554 56799999988
Q ss_pred CceeccccCCCCeEEEEEcC----CCCEEEEE
Q 018806 286 WTSEPWSSTSGFVTGATWDP----EGRMILLA 313 (350)
Q Consensus 286 ~~~~~~~~~~~~v~~~~~s~----~g~~l~~~ 313 (350)
..-.-...-...+.++.+-. +..++++|
T Consensus 83 N~d~Fyke~~DGvn~i~~g~~~~~~~~l~ivG 114 (136)
T PF14781_consen 83 NSDLFYKEVPDGVNAIVIGKLGDIPSPLVIVG 114 (136)
T ss_pred CchhhhhhCccceeEEEEEecCCCCCcEEEEC
Confidence 77654444556677776632 34455554
No 462
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=85.13 E-value=32 Score=31.98 Aligned_cols=65 Identities=11% Similarity=0.066 Sum_probs=34.4
Q ss_pred CCEEEEEECCCeEEEEEccCCCCCceeEecCCCC-----CCee--EEEEeeCCCeEEEEecCCcEEEEecCCCCC
Q 018806 111 KHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQ-----RDVK--VLEWRPNGGRSLSVGCKGGICIWAPSYPGN 178 (350)
Q Consensus 111 g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~-----~~v~--~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~ 178 (350)
+..+++++.++.+.-.|..+ ++..-....... ..+. .+... ++..++++..++.|+-+|.++++.
T Consensus 61 ~g~vy~~~~~g~l~AlD~~t--G~~~W~~~~~~~~~~~~~~~~~~g~~~~-~~~~V~v~~~~g~v~AlD~~TG~~ 132 (488)
T cd00216 61 DGDMYFTTSHSALFALDAAT--GKVLWRYDPKLPADRGCCDVVNRGVAYW-DPRKVFFGTFDGRLVALDAETGKQ 132 (488)
T ss_pred CCEEEEeCCCCcEEEEECCC--ChhhceeCCCCCccccccccccCCcEEc-cCCeEEEecCCCeEEEEECCCCCE
Confidence 34566667778887777743 443322211111 0010 11111 125677777789999999875544
No 463
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=84.96 E-value=0.9 Score=43.89 Aligned_cols=113 Identities=19% Similarity=0.234 Sum_probs=68.1
Q ss_pred CceeeEEECC-CCCeEEEEEeCCCeEEEEeCCC--CCcee-e-----eecCCCeEEEEEcC---CCCEEEEEecCCeEEE
Q 018806 213 EQITALSWGP-DGRYLASASYESSSFTIWDVAQ--GLGTP-I-----RRGFGGLSILKWSP---TGDYFFAAKFDGTFYL 280 (350)
Q Consensus 213 ~~v~~~~~sp-~g~~l~~~~~d~g~i~iwd~~~--~~~~~-~-----~~~~~~v~~~~~sp---~g~~l~~~~~d~~v~i 280 (350)
+.+-.+.|-. +...+. .+-|.+.+||+.- |+... + ......+.-+.|+| +.-++..+-.++.+++
T Consensus 133 G~v~dl~fah~~~pk~~---~~vg~lfVy~vd~l~G~iq~~l~v~~~~p~gs~~~~V~wcp~~~~~~~ic~~~~~~~i~l 209 (1283)
T KOG1916|consen 133 GGVGDLQFAHTKCPKGR---RLVGELFVYDVDVLQGEIQPQLEVTPITPYGSDPQLVSWCPIAVNKVYICYGLKGGEIRL 209 (1283)
T ss_pred CCcccccccccCChHHH---HHhhhhheeehHhhccccccceEEeecCcCCCCcceeeecccccccceeeeccCCCceeE
Confidence 5677777743 222222 2226788998763 33221 1 11223445566665 5667777778889999
Q ss_pred EeCCCCceeccccCCCCeEEE-----------EEcCCCCEEEEEE-CCCeEEEEEEeCCC
Q 018806 281 WETNTWTSEPWSSTSGFVTGA-----------TWDPEGRMILLAF-AGSLTLGSIHFASK 328 (350)
Q Consensus 281 wd~~~~~~~~~~~~~~~v~~~-----------~~s~~g~~l~~~~-~~~~~~~~~~~~~~ 328 (350)
.+..+....-+..|..++..+ ..||||+.++.++ ++....|.+.+.++
T Consensus 210 L~~~ra~~~l~rsHs~~~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG~v~f~Qiyi~g~ 269 (1283)
T KOG1916|consen 210 LNINRALRSLFRSHSQRVTDMAFFAEGVLKLASLSPDGTVFAWAISDGSVGFYQIYITGK 269 (1283)
T ss_pred eeechHHHHHHHhcCCCcccHHHHhhchhhheeeCCCCcEEEEeecCCccceeeeeeecc
Confidence 888765543334455444333 3689999999987 66667777776654
No 464
>KOG1900 consensus Nuclear pore complex, Nup155 component (D Nup154, sc Nup157/Nup170) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=84.79 E-value=34 Score=35.19 Aligned_cols=146 Identities=10% Similarity=0.140 Sum_probs=85.2
Q ss_pred ECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEE--------eeCCCeEEEEecCCcEEEEecCCCCCCceeecccccc
Q 018806 118 SGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEW--------RPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASF 189 (350)
Q Consensus 118 s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~--------sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~ 189 (350)
+.|+.+.+|+++. +.....+ .+-...|..+.. .|.=++++..++--.|.++-+.............
T Consensus 96 TiDn~L~lWny~~--~~e~~~~-d~~shtIl~V~LvkPkpgvFv~~IqhlLvvaT~~ei~ilgV~~~~~~~~~~~f~--- 169 (1311)
T KOG1900|consen 96 TIDNNLFLWNYES--DNELAEY-DGLSHTILKVGLVKPKPGVFVPEIQHLLVVATPVEIVILGVSFDEFTGELSIFN--- 169 (1311)
T ss_pred EeCCeEEEEEcCC--CCccccc-cchhhhheeeeeecCCCCcchhhhheeEEecccceEEEEEEEeccccCcccccc---
Confidence 5688999999975 2222222 344445655543 3334577788887777777665333221111000
Q ss_pred cceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEE--eCCCC---C-c----------------
Q 018806 190 LGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIW--DVAQG---L-G---------------- 247 (350)
Q Consensus 190 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iw--d~~~~---~-~---------------- 247 (350)
-.-.+... +..|.++....+|+.+++| .| |.|+-. ....+ + +
T Consensus 170 -------------~~~~i~~d-g~~V~~I~~t~nGRIF~~G-~d-g~lyEl~Yq~~~gWf~~rc~Kiclt~s~ls~lvPs 233 (1311)
T KOG1900|consen 170 -------------TSFKISVD-GVSVNCITYTENGRIFFAG-RD-GNLYELVYQAEDGWFGSRCRKICLTKSVLSSLVPS 233 (1311)
T ss_pred -------------cceeeecC-CceEEEEEeccCCcEEEee-cC-CCEEEEEEeccCchhhcccccccCchhHHHHhhhh
Confidence 00001111 3578899988888877765 45 344432 22221 0 0
Q ss_pred -eeee-ecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCC
Q 018806 248 -TPIR-RGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNT 285 (350)
Q Consensus 248 -~~~~-~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~ 285 (350)
..+. .+..+|..+........+.+-++.++|.+||+..
T Consensus 234 ~~~~~~~~~dpI~qi~ID~SR~IlY~lsek~~v~~Y~i~~ 273 (1311)
T KOG1900|consen 234 LLSVPGSSKDPIRQITIDNSRNILYVLSEKGTVSAYDIGG 273 (1311)
T ss_pred hhcCCCCCCCcceeeEeccccceeeeeccCceEEEEEccC
Confidence 1122 3356889999988888888999999999999976
No 465
>PLN02193 nitrile-specifier protein
Probab=84.31 E-value=35 Score=31.62 Aligned_cols=68 Identities=10% Similarity=-0.004 Sum_probs=38.1
Q ss_pred CCCeEEEEEeCC---CeEEEEeCCCCCceeeeec---C-CCeEEEEEcCCCCEEEEEecC--------------CeEEEE
Q 018806 223 DGRYLASASYES---SSFTIWDVAQGLGTPIRRG---F-GGLSILKWSPTGDYFFAAKFD--------------GTFYLW 281 (350)
Q Consensus 223 ~g~~l~~~~~d~---g~i~iwd~~~~~~~~~~~~---~-~~v~~~~~sp~g~~l~~~~~d--------------~~v~iw 281 (350)
+++.++.++.+. ..+.+||..+.+...+... . ......+..-++++++.|+.+ ..+.+|
T Consensus 328 ~gkiyviGG~~g~~~~dv~~yD~~t~~W~~~~~~g~~P~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~ndv~~~ 407 (470)
T PLN02193 328 QGKVWVVYGFNGCEVDDVHYYDPVQDKWTQVETFGVRPSERSVFASAAVGKHIVIFGGEIAMDPLAHVGPGQLTDGTFAL 407 (470)
T ss_pred CCcEEEEECCCCCccCceEEEECCCCEEEEeccCCCCCCCcceeEEEEECCEEEEECCccCCccccccCccceeccEEEE
Confidence 466666665431 2689999988765544321 1 111111222356666777642 258899
Q ss_pred eCCCCceec
Q 018806 282 ETNTWTSEP 290 (350)
Q Consensus 282 d~~~~~~~~ 290 (350)
|+.+.+-..
T Consensus 408 D~~t~~W~~ 416 (470)
T PLN02193 408 DTETLQWER 416 (470)
T ss_pred EcCcCEEEE
Confidence 998876543
No 466
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=84.10 E-value=23 Score=29.37 Aligned_cols=143 Identities=17% Similarity=0.225 Sum_probs=77.2
Q ss_pred EEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEec-C--CcEEEEecCCCCCCceeecccccccceecCCCCCc
Q 018806 124 IVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGC-K--GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTR 200 (350)
Q Consensus 124 ~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~-d--~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 200 (350)
.+||+.+.+.. .+....+-.+.+-.+-+||+.+.++|. + ..+++++........ .
T Consensus 49 ~~yD~~tn~~r---pl~v~td~FCSgg~~L~dG~ll~tGG~~~G~~~ir~~~p~~~~~~~-------------------~ 106 (243)
T PF07250_consen 49 VEYDPNTNTFR---PLTVQTDTFCSGGAFLPDGRLLQTGGDNDGNKAIRIFTPCTSDGTC-------------------D 106 (243)
T ss_pred EEEecCCCcEE---eccCCCCCcccCcCCCCCCCEEEeCCCCccccceEEEecCCCCCCC-------------------C
Confidence 37888653322 222223444555567799877766665 2 557777654201100 1
Q ss_pred eEEe-eeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCC--Ccee--eeec-----C-CCeEEEEEcCCCCEE
Q 018806 201 WTLV-DFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQG--LGTP--IRRG-----F-GGLSILKWSPTGDYF 269 (350)
Q Consensus 201 ~~~~-~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~--~~~~--~~~~-----~-~~v~~~~~sp~g~~l 269 (350)
|... ..+.. ....-+..--|||+.|+.++...-+..+|.-... .... +... . .-.-.+-..|+|+.+
T Consensus 107 w~e~~~~m~~--~RWYpT~~~L~DG~vlIvGG~~~~t~E~~P~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lF 184 (243)
T PF07250_consen 107 WTESPNDMQS--GRWYPTATTLPDGRVLIVGGSNNPTYEFWPPKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLF 184 (243)
T ss_pred ceECcccccC--CCccccceECCCCCEEEEeCcCCCcccccCCccCCCCceeeecchhhhccCccccCceEEEcCCCCEE
Confidence 1111 11222 2355566667899999999887546666665322 1111 1111 1 112346668999999
Q ss_pred EEEecCCeEEEEeCCCCce-eccc
Q 018806 270 FAAKFDGTFYLWETNTWTS-EPWS 292 (350)
Q Consensus 270 ~~~~~d~~v~iwd~~~~~~-~~~~ 292 (350)
+.+..+. .|||..+.+. ..+.
T Consensus 185 i~an~~s--~i~d~~~n~v~~~lP 206 (243)
T PF07250_consen 185 IFANRGS--IIYDYKTNTVVRTLP 206 (243)
T ss_pred EEEcCCc--EEEeCCCCeEEeeCC
Confidence 8887554 5678888766 3443
No 467
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=83.85 E-value=50 Score=33.06 Aligned_cols=220 Identities=11% Similarity=0.094 Sum_probs=110.9
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEe--cCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCC-
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACIL--TSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGN- 178 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~--~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~- 178 (350)
|--..+--|..+|.++..||.+.-+.++..++.....- .. ...++.--.|+..++..+.+.+|+-..+|..+..-.
T Consensus 586 Il~~~~e~d~~yLlvalgdG~l~~fv~d~~tg~lsd~Kk~~l-Gt~P~~Lr~f~sk~~t~vfa~sdrP~viY~~n~kLv~ 664 (1096)
T KOG1897|consen 586 ILLTTFEGDIHYLLVALGDGALLYFVLDINTGQLSDRKKVTL-GTQPISLRTFSSKSRTAVFALSDRPTVIYSSNGKLVY 664 (1096)
T ss_pred eeeEEeeccceEEEEEcCCceEEEEEEEcccceEcccccccc-CCCCcEEEEEeeCCceEEEEeCCCCEEEEecCCcEEE
Confidence 33344545678999999999998887765555322111 11 234666667777766666666666555665441111
Q ss_pred ----------CceeecccccccceecCCCCCc--eEEeeeccCC------CCCceeeEEECCCCCeEEEEEeC-------
Q 018806 179 ----------AASVRSGAASFLGALSRGPGTR--WTLVDFLRSQ------NGEQITALSWGPDGRYLASASYE------- 233 (350)
Q Consensus 179 ----------~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~------~~~~v~~~~~sp~g~~l~~~~~d------- 233 (350)
..++...+ ....+.....+. +...+.++.- -......+++.+....+.+.+..
T Consensus 665 spls~kev~~~c~f~s~a--~~d~l~~~~~~~l~i~tid~iqkl~irtvpl~~~prrI~~q~~sl~~~v~s~r~e~~~~~ 742 (1096)
T KOG1897|consen 665 SPLSLKEVNHMCPFNSDA--YPDSLASANGGALTIGTIDEIQKLHIRTVPLGESPRRICYQESSLTFGVLSNRIESSAEY 742 (1096)
T ss_pred eccchHHhhhhccccccc--CCceEEEecCCceEEEEecchhhcceeeecCCCChhheEecccceEEEEEecccccchhh
Confidence 11111110 001111111221 1112222111 01355677777644444433221
Q ss_pred ----C--CeEEEEeCCCCCceeeeecC-----CCeEEEEEcCC-CCEEEEEe----------cCCeEEEEeCCC-Cceec
Q 018806 234 ----S--SSFTIWDVAQGLGTPIRRGF-----GGLSILKWSPT-GDYFFAAK----------FDGTFYLWETNT-WTSEP 290 (350)
Q Consensus 234 ----~--g~i~iwd~~~~~~~~~~~~~-----~~v~~~~~sp~-g~~l~~~~----------~d~~v~iwd~~~-~~~~~ 290 (350)
. -.++++|-++.+........ -.+.++.|..| +.++++|. ..|.|.+|.+.. ++.+.
T Consensus 743 ~~ee~~~s~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~ 822 (1096)
T KOG1897|consen 743 YGEEYEVSFLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTGLVYPDENEPVNGRIIVFEFEELNSLEL 822 (1096)
T ss_pred cCCcceEEEEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEEeeccCCCCcccceEEEEEEecCCceee
Confidence 0 14666776655443322211 22445568777 67777764 247888888877 33322
Q ss_pred cc--cCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 291 WS--STSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 291 ~~--~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
.. .-.+.+.++. --+|++|| |-+....++.|...
T Consensus 823 v~e~~v~Gav~aL~-~fngkllA-~In~~vrLye~t~~ 858 (1096)
T KOG1897|consen 823 VAETVVKGAVYALV-EFNGKLLA-GINQSVRLYEWTTE 858 (1096)
T ss_pred eeeeeeccceeehh-hhCCeEEE-ecCcEEEEEEcccc
Confidence 22 2234455443 23577766 55666777777655
No 468
>PLN02153 epithiospecifier protein
Probab=83.52 E-value=30 Score=30.32 Aligned_cols=54 Identities=15% Similarity=0.001 Sum_probs=30.2
Q ss_pred eEEEEeCCCCCceeeeec---CCC-eEEEEEcCCCCEEEEEecC--------------CeEEEEeCCCCcee
Q 018806 236 SFTIWDVAQGLGTPIRRG---FGG-LSILKWSPTGDYFFAAKFD--------------GTFYLWETNTWTSE 289 (350)
Q Consensus 236 ~i~iwd~~~~~~~~~~~~---~~~-v~~~~~sp~g~~l~~~~~d--------------~~v~iwd~~~~~~~ 289 (350)
.+.+||..+.+-..+... ..+ ....+...++++++.|+.. +.++.||.++.+-.
T Consensus 218 ~v~~yd~~~~~W~~~~~~g~~P~~r~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~n~v~~~d~~~~~W~ 289 (341)
T PLN02153 218 AVQFFDPASGKWTEVETTGAKPSARSVFAHAVVGKYIIIFGGEVWPDLKGHLGPGTLSNEGYALDTETLVWE 289 (341)
T ss_pred ceEEEEcCCCcEEeccccCCCCCCcceeeeEEECCEEEEECcccCCccccccccccccccEEEEEcCccEEE
Confidence 688999888765544321 111 1111122356666777641 26788888776543
No 469
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=83.25 E-value=27 Score=29.64 Aligned_cols=183 Identities=13% Similarity=0.031 Sum_probs=0.0
Q ss_pred eeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCCcEEEEecCCCCCCce
Q 018806 102 LQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAAS 181 (350)
Q Consensus 102 V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~ 181 (350)
|..+...-+-.++..|-.--..-+|+....+........ .-.+-+..+.++.+ +.+.+-.+.-++|.|+..+..+..
T Consensus 45 vsavdv~~~ya~v~qG~~l~i~ditn~~~~t~~~l~~~i-~~~~l~~Dv~vse~--yvyvad~ssGL~IvDIS~P~sP~~ 121 (370)
T COG5276 45 VSAVDVRGAYAYVGQGFILAILDITNVSLQTHDVLLSVI-NARDLFADVRVSEE--YVYVADWSSGLRIVDISTPDSPTL 121 (370)
T ss_pred cccccccccccccccCceEeeccccCcccccCcceEEEE-ehhhhhheeEeccc--EEEEEcCCCceEEEeccCCCCcce
Q ss_pred eecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeee----cCCCe
Q 018806 182 VRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRR----GFGGL 257 (350)
Q Consensus 182 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~----~~~~v 257 (350)
+... +-.=..-.|.-.|++...+..++ -+.+.|+.+.+...+.+ .....
T Consensus 122 ~~~l--------------------------nt~gyaygv~vsGn~aYVadldd-gfLivdvsdpssP~lagrya~~~~d~ 174 (370)
T COG5276 122 IGFL--------------------------NTDGYAYGVYVSGNYAYVADLDD-GFLIVDVSDPSSPQLAGRYALPGGDT 174 (370)
T ss_pred eccc--------------------------cCCceEEEEEecCCEEEEeeccC-cEEEEECCCCCCceeeeeeccCCCCc
Q ss_pred EEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccC---CCCeEEEEEcCCCCEEEEEECC
Q 018806 258 SILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSST---SGFVTGATWDPEGRMILLAFAG 316 (350)
Q Consensus 258 ~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~---~~~v~~~~~s~~g~~l~~~~~~ 316 (350)
..++.| |++-..+..|+-+.|-|+.....-.+.++ ...+.++..+++..+++....+
T Consensus 175 ~~v~IS--Gn~AYvA~~d~GL~ivDVSnp~sPvli~~~n~g~g~~sv~vsdnr~y~vvy~eg 234 (370)
T COG5276 175 HDVAIS--GNYAYVAWRDGGLTIVDVSNPHSPVLIGSYNTGPGTYSVSVSDNRAYLVVYDEG 234 (370)
T ss_pred eeEEEe--cCeEEEEEeCCCeEEEEccCCCCCeEEEEEecCCceEEEEecCCeeEEEEcccc
No 470
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=83.12 E-value=20 Score=30.50 Aligned_cols=77 Identities=13% Similarity=0.210 Sum_probs=52.0
Q ss_pred CeEEEEeCCCCCceeeee-cCCCeEEEEEcCCCCEEEEEe------cCCeEEEEeCCCCceeccccC-----CCCeEEEE
Q 018806 235 SSFTIWDVAQGLGTPIRR-GFGGLSILKWSPTGDYFFAAK------FDGTFYLWETNTWTSEPWSST-----SGFVTGAT 302 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~-~~~~v~~~~~sp~g~~l~~~~------~d~~v~iwd~~~~~~~~~~~~-----~~~v~~~~ 302 (350)
..|++||..+.+....-. -.+.|..+.|..+.+.++.|. ....+..||..+.+...+... .++|..+.
T Consensus 16 ~~lC~yd~~~~qW~~~g~~i~G~V~~l~~~~~~~Llv~G~ft~~~~~~~~la~yd~~~~~w~~~~~~~s~~ipgpv~a~~ 95 (281)
T PF12768_consen 16 PGLCLYDTDNSQWSSPGNGISGTVTDLQWASNNQLLVGGNFTLNGTNSSNLATYDFKNQTWSSLGGGSSNSIPGPVTALT 95 (281)
T ss_pred CEEEEEECCCCEeecCCCCceEEEEEEEEecCCEEEEEEeeEECCCCceeEEEEecCCCeeeecCCcccccCCCcEEEEE
Confidence 379999998877654433 357899999986666667664 345788999988776554442 36777777
Q ss_pred Ec-CCCCEEE
Q 018806 303 WD-PEGRMIL 311 (350)
Q Consensus 303 ~s-~~g~~l~ 311 (350)
+. .|+..+.
T Consensus 96 ~~~~d~~~~~ 105 (281)
T PF12768_consen 96 FISNDGSNFW 105 (281)
T ss_pred eeccCCceEE
Confidence 63 3444344
No 471
>KOG1520 consensus Predicted alkaloid synthase/Surface mucin Hemomucin [General function prediction only]
Probab=82.12 E-value=35 Score=30.09 Aligned_cols=53 Identities=15% Similarity=0.273 Sum_probs=37.6
Q ss_pred cCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCCeEEEEEEeC
Q 018806 274 FDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGSLTLGSIHFA 326 (350)
Q Consensus 274 ~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~~~~~~~~~~ 326 (350)
.+|.+.-||..+.....+...-.-...++.|||+.+++++-....++...-+.
T Consensus 197 ~~GRl~~YD~~tK~~~VLld~L~F~NGlaLS~d~sfvl~~Et~~~ri~rywi~ 249 (376)
T KOG1520|consen 197 PTGRLFRYDPSTKVTKVLLDGLYFPNGLALSPDGSFVLVAETTTARIKRYWIK 249 (376)
T ss_pred CccceEEecCcccchhhhhhcccccccccCCCCCCEEEEEeeccceeeeeEec
Confidence 46778888888777666665555678899999999999886444444444443
No 472
>PRK13615 lipoprotein LpqB; Provisional
Probab=82.03 E-value=47 Score=31.44 Aligned_cols=153 Identities=14% Similarity=0.151 Sum_probs=88.1
Q ss_pred eEEEEeeCCCeEEEEecCCcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeE
Q 018806 148 KVLEWRPNGGRSLSVGCKGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYL 227 (350)
Q Consensus 148 ~~~~~sp~~~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l 227 (350)
.+++.++++..+++...++.+.++... +....+.. ...++.-+|.++| .+
T Consensus 337 ~s~avS~dg~~~A~v~~~~~l~vg~~~--~~~~~~~~---------------------------~~~Lt~PS~d~~g-~v 386 (557)
T PRK13615 337 DAATLSADGRQAAVRNASGVWSVGDGD--RDAVLLDT---------------------------RPGLVAPSLDAQG-YV 386 (557)
T ss_pred ccceEcCCCceEEEEcCCceEEEecCC--Ccceeecc---------------------------CCccccCcCcCCC-CE
Confidence 778999998887777666767666544 11111111 1246667777777 55
Q ss_pred EEEEeCCCeEEEEeCCC-CCceeee---ecCCCeEEEEEcCCCCEEEEEec---CCeEEEEeCC--CCceecc-------
Q 018806 228 ASASYESSSFTIWDVAQ-GLGTPIR---RGFGGLSILKWSPTGDYFFAAKF---DGTFYLWETN--TWTSEPW------- 291 (350)
Q Consensus 228 ~~~~~d~g~i~iwd~~~-~~~~~~~---~~~~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~--~~~~~~~------- 291 (350)
-+.-..+ ..++..... +....+. ...+.|..+..|+||-.++.... .+.|+|--+. .+....+
T Consensus 387 Wtv~~g~-~~~l~~~~~~G~~~~v~v~~~~~~~I~~lrvSrDG~R~Avi~~~~g~~~V~va~V~R~~~~P~~L~~~p~~l 465 (557)
T PRK13615 387 WSTPASD-PRGLVAWGPDGVGHPVAVSWTATGRVVSLEVARDGARVLVQLETGAGPQLLVASIVRDGGVPTSLTTTPLEL 465 (557)
T ss_pred EEEeCCC-ceEEEEecCCCceEEeeccccCCCeeEEEEeCCCccEEEEEEecCCCCEEEEEEEEeCCCcceEeeeccEEc
Confidence 4444332 344443322 3322221 12357999999999998876533 3456654332 2211122
Q ss_pred ccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCCCCCC
Q 018806 292 SSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHFASKPPS 331 (350)
Q Consensus 292 ~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~~~~~ 331 (350)
......+.+++|..++..++.+. +.+..++.+.+.....+
T Consensus 466 ~~~l~~v~sl~W~~~~~laVl~~~~~~~~~v~~v~v~g~~~~ 507 (557)
T PRK13615 466 LASPGTPLDATWVDELDVATLTLAPDGERQVELHQVGGPSKD 507 (557)
T ss_pred ccCcCcceeeEEcCCCEEEEEeccCCCCceEEEEECCCcccc
Confidence 22234789999999999877763 33356777777654333
No 473
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=81.09 E-value=10 Score=36.50 Aligned_cols=76 Identities=12% Similarity=0.237 Sum_probs=52.8
Q ss_pred ccCeeEEEEe--cCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCC----C--eEEEEecCCcEEE
Q 018806 99 EVDLQGVSWH--QHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNG----G--RSLSVGCKGGICI 170 (350)
Q Consensus 99 ~~~V~~v~~s--p~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~----~--~l~~~~~d~~v~i 170 (350)
+..+++++++ ...++||++++...|.||-+...+.+....-...+...|-+++|-++. + .+++++-.|.+.+
T Consensus 163 ~~SaWGLdIh~~~~~rlIAVSsNs~~VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~v~~ 242 (717)
T PF08728_consen 163 GASAWGLDIHDYKKSRLIAVSSNSQEVTVFAFALVDERFYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVATDISGEVWT 242 (717)
T ss_pred CCceeEEEEEecCcceEEEEecCCceEEEEEEeccccccccccccccccCCCeeEeecCCCCCccceEEEEEeccCcEEE
Confidence 4578999999 888999999999999998876432222221122366779999997763 1 3444444699988
Q ss_pred EecC
Q 018806 171 WAPS 174 (350)
Q Consensus 171 wd~~ 174 (350)
|++.
T Consensus 243 ~~I~ 246 (717)
T PF08728_consen 243 FKIK 246 (717)
T ss_pred EEEE
Confidence 8883
No 474
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=80.39 E-value=39 Score=33.41 Aligned_cols=65 Identities=14% Similarity=0.107 Sum_probs=41.2
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeE-------------EEEEcC--CCCEEEEEec----------CCeE
Q 018806 224 GRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLS-------------ILKWSP--TGDYFFAAKF----------DGTF 278 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~-------------~~~~sp--~g~~l~~~~~----------d~~v 278 (350)
+..++.++.| |.+.-.|.++|+....+...+.+. .+.-.| .+..+++|+. +|.|
T Consensus 260 ~~rV~~~T~D-g~LiALDA~TGk~~W~fg~~G~vdl~~~~g~~~~g~~~~ts~P~V~~g~VIvG~~v~d~~~~~~~~G~I 338 (764)
T TIGR03074 260 ARRIILPTSD-ARLIALDADTGKLCEDFGNNGTVDLTAGMGTTPPGYYYPTSPPLVAGTTVVIGGRVADNYSTDEPSGVI 338 (764)
T ss_pred CCEEEEecCC-CeEEEEECCCCCEEEEecCCCceeeecccCcCCCcccccccCCEEECCEEEEEecccccccccCCCcEE
Confidence 4577778888 699999999998765443322221 111122 1334555532 5889
Q ss_pred EEEeCCCCcee
Q 018806 279 YLWETNTWTSE 289 (350)
Q Consensus 279 ~iwd~~~~~~~ 289 (350)
+-+|.++|+..
T Consensus 339 ~A~Da~TGkl~ 349 (764)
T TIGR03074 339 RAFDVNTGALV 349 (764)
T ss_pred EEEECCCCcEe
Confidence 99999999874
No 475
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=80.11 E-value=9.6 Score=35.80 Aligned_cols=78 Identities=18% Similarity=0.157 Sum_probs=45.3
Q ss_pred CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCe--EEEEEcCCCCEEEE
Q 018806 235 SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFV--TGATWDPEGRMILL 312 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v--~~~~~s~~g~~l~~ 312 (350)
|.|.-+|+.+++.........+...-...-.+..++.++.+|.++.+|.++|+..--......+ .=+.|.-+|++.++
T Consensus 441 g~l~AiD~~tGk~~W~~~~~~p~~~~~l~t~g~lvf~g~~~G~l~a~D~~TGe~lw~~~~g~~~~a~P~ty~~~G~qYv~ 520 (527)
T TIGR03075 441 GSLIAWDPITGKIVWEHKEDFPLWGGVLATAGDLVFYGTLEGYFKAFDAKTGEELWKFKTGSGIVGPPVTYEQDGKQYVA 520 (527)
T ss_pred eeEEEEeCCCCceeeEecCCCCCCCcceEECCcEEEEECCCCeEEEEECCCCCEeEEEeCCCCceecCEEEEeCCEEEEE
Confidence 4678888888876654443322111112224556777888999999999999984322222222 22344456765443
No 476
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=79.19 E-value=8.7 Score=36.31 Aligned_cols=33 Identities=21% Similarity=0.308 Sum_probs=25.8
Q ss_pred CeEEEEEcC----CCCEEEEEecCCeEEEEeCCCCce
Q 018806 256 GLSILKWSP----TGDYFFAAKFDGTFYLWETNTWTS 288 (350)
Q Consensus 256 ~v~~~~~sp----~g~~l~~~~~d~~v~iwd~~~~~~ 288 (350)
....++++. +..+|++.+.|+++|+||+.++++
T Consensus 216 ~~~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~~ 252 (547)
T PF11715_consen 216 VAASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQC 252 (547)
T ss_dssp -EEEEEE-----ETTTEEEEEETTSEEEEEETTTTCE
T ss_pred ccceEEEecceeCCCCEEEEEeCCCeEEEEECCCCeE
Confidence 345566666 677899999999999999999988
No 477
>TIGR03032 conserved hypothetical protein TIGR03032. This protein family is uncharacterized. A number of motifs are conserved perfectly among all member sequences. The function of this protein is unknown.
Probab=78.77 E-value=42 Score=28.93 Aligned_cols=54 Identities=15% Similarity=0.355 Sum_probs=42.4
Q ss_pred EEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEEC
Q 018806 259 ILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFA 315 (350)
Q Consensus 259 ~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~ 315 (350)
+..|. +|++.++-+..|.|.-+|.++|+......-.+....++|. |++++++.+
T Consensus 207 SPRWh-dgrLwvldsgtGev~~vD~~~G~~e~Va~vpG~~rGL~f~--G~llvVgmS 260 (335)
T TIGR03032 207 SPRWY-QGKLWLLNSGRGELGYVDPQAGKFQPVAFLPGFTRGLAFA--GDFAFVGLS 260 (335)
T ss_pred CCcEe-CCeEEEEECCCCEEEEEcCCCCcEEEEEECCCCCccccee--CCEEEEEec
Confidence 34454 6777778788899999999989887666666778889998 899888753
No 478
>TIGR02171 Fb_sc_TIGR02171 Fibrobacter succinogenes paralogous family TIGR02171. This model describes a paralogous family of the rumen bacterium Fibrobacter succinogenes. Eleven members are found in Fibrobacter succinogenes S85, averaging over 900 amino acids in length. More than half are predicted lipoproteins. The function is unknown.
Probab=78.68 E-value=9.7 Score=37.54 Aligned_cols=54 Identities=11% Similarity=0.108 Sum_probs=40.6
Q ss_pred cCCeEEEEeCCCCceecc-ccCCCCeEEEEEcCCCCEEEEE-E-CC---CeEEEEEEeCC
Q 018806 274 FDGTFYLWETNTWTSEPW-SSTSGFVTGATWDPEGRMILLA-F-AG---SLTLGSIHFAS 327 (350)
Q Consensus 274 ~d~~v~iwd~~~~~~~~~-~~~~~~v~~~~~s~~g~~l~~~-~-~~---~~~~~~~~~~~ 327 (350)
..+.|.+-|......+.+ ..+..+|.+.+|||||+.|+.+ + .+ ...++.-++..
T Consensus 327 ~~~~L~~~D~dG~n~~~ve~~~~~~i~sP~~SPDG~~vAY~ts~e~~~g~s~vYv~~L~t 386 (912)
T TIGR02171 327 VTGNLAYIDYTKGASRAVEIEDTISVYHPDISPDGKKVAFCTGIEGLPGKSSVYVRNLNA 386 (912)
T ss_pred CCCeEEEEecCCCCceEEEecCCCceecCcCCCCCCEEEEEEeecCCCCCceEEEEehhc
Confidence 345899999988777766 6778899999999999999994 3 33 44566666554
No 479
>COG5290 IkappaB kinase complex, IKAP component [Transcription]
Probab=78.64 E-value=70 Score=31.38 Aligned_cols=92 Identities=16% Similarity=0.194 Sum_probs=52.4
Q ss_pred eEEECCCCCeEEEEEeCC----CeEEEEeCCCC---CceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCce-
Q 018806 217 ALSWGPDGRYLASASYES----SSFTIWDVAQG---LGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTS- 288 (350)
Q Consensus 217 ~~~~sp~g~~l~~~~~d~----g~i~iwd~~~~---~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~- 288 (350)
.++|-|+|..+++-..|+ -.|.++.-+.- +..........+...+|+-....++.+ ..+.+++|-..+...
T Consensus 251 ~LSWkpqgS~~ati~td~~~~S~~ViFfErNGLrHGef~lr~~~dEk~~~~~wn~~s~vlav~-~~n~~~lwttkNyhWY 329 (1243)
T COG5290 251 QLSWKPQGSKYATIGTDGCSTSESVIFFERNGLRHGEFDLRVGCDEKAFLENWNLLSTVLAVA-EGNLLKLWTTKNYHWY 329 (1243)
T ss_pred ccccccCCceeeeeccCCCCCcceEEEEccCCcccCCccccCCchhhhhhhhhhHHHHHHHHh-hcceEEEEEccceEEE
Confidence 489999999999876541 14556554322 111112223345667787666655543 456799997766443
Q ss_pred eccccCCCCeEEEEEcCCCCE
Q 018806 289 EPWSSTSGFVTGATWDPEGRM 309 (350)
Q Consensus 289 ~~~~~~~~~v~~~~~s~~g~~ 309 (350)
....-.-..+.-+.|+|....
T Consensus 330 LK~e~~ip~~s~vkwhpe~~n 350 (1243)
T COG5290 330 LKVERQIPGISYVKWHPEEKN 350 (1243)
T ss_pred EEEeecCCCcceeeeccccCc
Confidence 111112234556788886543
No 480
>COG5167 VID27 Protein involved in vacuole import and degradation [Intracellular trafficking and secretion]
Probab=78.56 E-value=56 Score=30.21 Aligned_cols=59 Identities=14% Similarity=0.179 Sum_probs=41.7
Q ss_pred CCeEEEEEeCCCeEEEEeCCCCCcee-eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeCC
Q 018806 224 GRYLASASYESSSFTIWDVAQGLGTP-IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWETN 284 (350)
Q Consensus 224 g~~l~~~~~d~g~i~iwd~~~~~~~~-~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~ 284 (350)
.-+++.++.. |.|++||.-...... +..-...|..+..+.+|+++++.+ ...+.+.|++
T Consensus 573 sGyIa~as~k-GDirLyDRig~rAKtalP~lG~aIk~idvta~Gk~ilaTC-k~yllL~d~~ 632 (776)
T COG5167 573 SGYIAAASRK-GDIRLYDRIGKRAKTALPGLGDAIKHIDVTANGKHILATC-KNYLLLTDVP 632 (776)
T ss_pred CceEEEecCC-CceeeehhhcchhhhcCcccccceeeeEeecCCcEEEEee-cceEEEEecc
Confidence 4588989888 799999965433332 333456788899999999987655 3556676664
No 481
>PF05787 DUF839: Bacterial protein of unknown function (DUF839); InterPro: IPR008557 This family consists of bacterial proteins of unknown function.
Probab=78.31 E-value=36 Score=31.94 Aligned_cols=21 Identities=24% Similarity=0.656 Sum_probs=17.8
Q ss_pred cCCCCeEEEEEcCCCCEEEEE
Q 018806 293 STSGFVTGATWDPEGRMILLA 313 (350)
Q Consensus 293 ~~~~~v~~~~~s~~g~~l~~~ 313 (350)
.....++.++|+||++.|++.
T Consensus 499 P~gaE~tG~~fspDg~tlFvn 519 (524)
T PF05787_consen 499 PNGAEITGPCFSPDGRTLFVN 519 (524)
T ss_pred CCCcccccceECCCCCEEEEE
Confidence 346789999999999999875
No 482
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=77.55 E-value=47 Score=28.82 Aligned_cols=28 Identities=0% Similarity=-0.208 Sum_probs=17.0
Q ss_pred CCCCeEEEEEeCCC---eEEEEeCCCCCcee
Q 018806 222 PDGRYLASASYESS---SFTIWDVAQGLGTP 249 (350)
Q Consensus 222 p~g~~l~~~~~d~g---~i~iwd~~~~~~~~ 249 (350)
-+++..+.++.+.. .+.+||..+.+...
T Consensus 170 ~~~~iYv~GG~~~~~~~~~~~yd~~~~~W~~ 200 (323)
T TIGR03548 170 LQNELYVFGGGSNIAYTDGYKYSPKKNQWQK 200 (323)
T ss_pred ECCEEEEEcCCCCccccceEEEecCCCeeEE
Confidence 35666677765421 35688888765443
No 483
>KOG2006 consensus WD40 repeat protein [General function prediction only]
Probab=77.35 E-value=16 Score=36.26 Aligned_cols=73 Identities=15% Similarity=0.264 Sum_probs=49.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEec--CCCCCCeeEEEEeeCCCeEEEEec-CCcEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILT--SDSQRDVKVLEWRPNGGRSLSVGC-KGGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~--~~~~~~v~~~~~sp~~~~l~~~~~-d~~v~iwd~~ 174 (350)
+-.+.+....++.+++|..-|.+.+++.+..++....... ..+...+..+.|.|++ ..++.+. .|...+|...
T Consensus 150 DAvc~SV~~e~~lla~G~~~g~v~~y~~~~~~ssl~~s~~~~~~~ti~~~~~~~~p~~-~~~av~~~~g~ls~wS~~ 225 (1023)
T KOG2006|consen 150 DAVCCSVNHEFQLLAYGTPVGEVLLYSIDEANSSLVFSNRDDDTLTVPDNNSSWRPDQ-NGFAVTWEKGFLAFWSNQ 225 (1023)
T ss_pred cceeeeccchhhhheecccccceeehhhhhhccceeeecccCccccccccccCcCCcc-ceeeeeecccceEEeccc
Confidence 3456666777889999999999999988654443322221 1244467788899984 4445444 5888888765
No 484
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=76.75 E-value=12 Score=35.47 Aligned_cols=70 Identities=9% Similarity=0.019 Sum_probs=39.5
Q ss_pred cCCCEEEEEECCCeEEEEEccCC--CCCceeEe-cCC--------------------CCCCeeEEEEee----CCCeEEE
Q 018806 109 QHKHIVAFISGSTQVIVRDYEDS--EGKDACIL-TSD--------------------SQRDVKVLEWRP----NGGRSLS 161 (350)
Q Consensus 109 p~g~~la~~s~d~~i~iw~~~~~--~~~~~~~~-~~~--------------------~~~~v~~~~~sp----~~~~l~~ 161 (350)
++...++.+..||.+........ .+...... ... ....+.+++.++ +...+++
T Consensus 156 ~~~~~l~v~~~dG~ll~l~~~~~~~~~~~~~~~~~~~~~~~~~l~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~t 235 (547)
T PF11715_consen 156 DSEANLVVSLQDGGLLRLKRSSGDSDGSVWSEELFNDSSWLRSLSGLFPWSYRGDNSSSSVAASLAVSSSEINDDTFLFT 235 (547)
T ss_dssp -SSSBEEEEESSS-EEEEEES----SSS-EE----STHHHHHCCTTTS-TT---SSSS---EEEEEE-----ETTTEEEE
T ss_pred cCCCEEEEEECCCCeEEEECCcccCCCCeeEEEEeCCCchhhhhhCcCCcccccCCCCCCccceEEEecceeCCCCEEEE
Confidence 46677888889998887776530 11111111 000 123455566665 5567778
Q ss_pred EecCCcEEEEecCCCCC
Q 018806 162 VGCKGGICIWAPSYPGN 178 (350)
Q Consensus 162 ~~~d~~v~iwd~~~~~~ 178 (350)
.+.|+++|+||+.....
T Consensus 236 l~~D~~LRiW~l~t~~~ 252 (547)
T PF11715_consen 236 LSRDHTLRIWSLETGQC 252 (547)
T ss_dssp EETTSEEEEEETTTTCE
T ss_pred EeCCCeEEEEECCCCeE
Confidence 88899999999996665
No 485
>PF01731 Arylesterase: Arylesterase; InterPro: IPR002640 The serum paraoxonases/arylesterases are enzymes that catalyse the hydrolysis of the toxic metabolites of a variety of organophosphorus insecticides. The enzymes hydrolyse a broad spectrum of organophosphate substrates, including paraoxon and a number of aromatic carboxylic acid esters (e.g., phenyl acetate), and hence confer resistance to organophosphate toxicity []. Mammals have 3 distinct paraoxonase types, termed PON1-3 [, ]. In mice and humans, the PON genes are found on the same chromosome in close proximity. PON activity has been found in variety of tissues, with highest levels in liver and serum - the source of serum PON is thought to be the liver. Unlike mammals, fish and avian species lack paraoxonase activity. Human and rabbit PONs appear to have two distinct Ca2+ binding sites, one required for stability and one required for catalytic activity. The Ca2+ dependency of PONs suggests a mechanism of hydrolysis where Ca2+ acts as the electrophillic catalyst, like that proposed for phospholipase A2. The paraoxonase enzymes, PON1 and PON3, are high density lipoprotein (HDL)- associated proteins capable of preventing oxidative modification of low density lipoproteins (LPL) []. Although PON2 has oxidative properties, the enzyme does not associate with HDL. Within a given species, PON1, PON2 and PON3 share ~60% amino acid sequence identity, whereas between mammalian species particular PONs (1,2 or 3) share 79-90% identity at the amino acid level. Human PON1 and PON3 share numerous conserved phosphorylation and N-glycosylation sites; however, it is not known whether the PON proteins are modified at these sites, or whether modification at these sites is required for activity in vivo []. This family consists of arylesterases (Also known as serum paraoxonase) 3.1.1.2 from EC. These enzymes hydrolyse organophosphorus esters such as paraoxon and are found in the liver and blood. They confer resistance to organophosphate toxicity []. Human arylesterase (PON1) P27169 from SWISSPROT is associated with HDL and may protect against LDL oxidation [].; GO: 0004064 arylesterase activity
Probab=76.22 E-value=19 Score=24.32 Aligned_cols=49 Identities=14% Similarity=0.307 Sum_probs=32.6
Q ss_pred CeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEe-cCCeEEEEeCCC
Q 018806 235 SSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAK-FDGTFYLWETNT 285 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~-~d~~v~iwd~~~ 285 (350)
|.|..||... .......-.....+.++|++++|.+++ ..+.|++|..+.
T Consensus 36 ~~Vvyyd~~~--~~~va~g~~~aNGI~~s~~~k~lyVa~~~~~~I~vy~~~~ 85 (86)
T PF01731_consen 36 GNVVYYDGKE--VKVVASGFSFANGIAISPDKKYLYVASSLAHSIHVYKRHK 85 (86)
T ss_pred ceEEEEeCCE--eEEeeccCCCCceEEEcCCCCEEEEEeccCCeEEEEEecC
Confidence 3566666432 223333445667899999999987665 468999998653
No 486
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=75.62 E-value=8.6 Score=36.85 Aligned_cols=68 Identities=19% Similarity=0.248 Sum_probs=48.0
Q ss_pred CceeeEEECCCCCeEEEEEeCCCeEEEEeCCCCCceeeeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 213 EQITALSWGPDGRYLASASYESSSFTIWDVAQGLGTPIRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 213 ~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
..++++.-+|.|+.++.+..| |.|++|+........+-....+-..+.|...| |++...|+.+--|.-
T Consensus 15 e~~~aiqshp~~~s~v~~~~d-~si~lfn~~~r~qski~~~~~p~~nlv~tnhg--l~~~tsdrr~la~~~ 82 (1636)
T KOG3616|consen 15 EFTTAIQSHPGGQSFVLAHQD-GSIILFNFIPRRQSKICEEAKPKENLVFTNHG--LVTATSDRRALAWKE 82 (1636)
T ss_pred ceeeeeeecCCCceEEEEecC-CcEEEEeecccchhhhhhhcCCccceeeeccc--eEEEeccchhheeec
Confidence 567888889999999999999 79999998766544444444455556666555 555556666666643
No 487
>PLN02153 epithiospecifier protein
Probab=74.49 E-value=59 Score=28.48 Aligned_cols=67 Identities=9% Similarity=0.156 Sum_probs=35.4
Q ss_pred CCCeEEEEEeCC----------CeEEEEeCCCCCceeeeecC------CCeEEEEEcCCCCEEEEEec------------
Q 018806 223 DGRYLASASYES----------SSFTIWDVAQGLGTPIRRGF------GGLSILKWSPTGDYFFAAKF------------ 274 (350)
Q Consensus 223 ~g~~l~~~~~d~----------g~i~iwd~~~~~~~~~~~~~------~~v~~~~~sp~g~~l~~~~~------------ 274 (350)
+++.++.++.+. ..+.+||..+.+-..+.... .....+. -++++.+.++.
T Consensus 137 ~~~iyv~GG~~~~~~~~~~~~~~~v~~yd~~~~~W~~l~~~~~~~~~r~~~~~~~--~~~~iyv~GG~~~~~~~gG~~~~ 214 (341)
T PLN02153 137 ENHVYVFGGVSKGGLMKTPERFRTIEAYNIADGKWVQLPDPGENFEKRGGAGFAV--VQGKIWVVYGFATSILPGGKSDY 214 (341)
T ss_pred CCEEEEECCccCCCccCCCcccceEEEEECCCCeEeeCCCCCCCCCCCCcceEEE--ECCeEEEEeccccccccCCccce
Confidence 456666665431 15778898876544322111 1111122 35665555442
Q ss_pred -CCeEEEEeCCCCceecc
Q 018806 275 -DGTFYLWETNTWTSEPW 291 (350)
Q Consensus 275 -d~~v~iwd~~~~~~~~~ 291 (350)
...|.+||..+.+-..+
T Consensus 215 ~~~~v~~yd~~~~~W~~~ 232 (341)
T PLN02153 215 ESNAVQFFDPASGKWTEV 232 (341)
T ss_pred ecCceEEEEcCCCcEEec
Confidence 14688999988765443
No 488
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=72.30 E-value=1.1e+02 Score=30.75 Aligned_cols=158 Identities=15% Similarity=0.100 Sum_probs=83.3
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeC--CCe---EEEEec-CCcEEEEecC
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPN--GGR---SLSVGC-KGGICIWAPS 174 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--~~~---l~~~~~-d~~v~iwd~~ 174 (350)
..+....+.+...++.++.++.+...++.. +.............|.|+.++|- ++. +++.|. +..+.+.-..
T Consensus 489 ~~ti~~~~~n~sqVvvA~~~~~l~y~~i~~--~~l~e~~~~~~e~evaCLDisp~~d~~~~s~~~aVG~Ws~~~~~l~~~ 566 (1096)
T KOG1897|consen 489 KITIGVVSANASQVVVAGGGLALFYLEIED--GGLREVSHKEFEYEVACLDISPLGDAPNKSRLLAVGLWSDISMILTFL 566 (1096)
T ss_pred ceEEEEEeecceEEEEecCccEEEEEEeec--cceeeeeeheecceeEEEecccCCCCCCcceEEEEEeecceEEEEEEC
Confidence 455555566666777777777776666643 22111221234567999999875 333 666554 4444433222
Q ss_pred CCCCCceeecccccccceecCCCCCceEEeeeccCCC-CCceeeEEECCCCCeEEEEEeCCCeEEEEeC--CCCCcee--
Q 018806 175 YPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQN-GEQITALSWGPDGRYLASASYESSSFTIWDV--AQGLGTP-- 249 (350)
Q Consensus 175 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~v~~~~~sp~g~~l~~~~~d~g~i~iwd~--~~~~~~~-- 249 (350)
-. ....+...+.+.. +..|.-..+--|..+|.++..| |.+..|.+ .+++...
T Consensus 567 pd----------------------~~~~~~~~l~~~~iPRSIl~~~~e~d~~yLlvalgd-G~l~~fv~d~~tg~lsd~K 623 (1096)
T KOG1897|consen 567 PD----------------------LILITHEQLSGEIIPRSILLTTFEGDIHYLLVALGD-GALLYFVLDINTGQLSDRK 623 (1096)
T ss_pred CC----------------------cceeeeeccCCCccchheeeEEeeccceEEEEEcCC-ceEEEEEEEcccceEcccc
Confidence 01 1111111111110 2345555666677889999888 78876654 4443321
Q ss_pred -eeecCCCeEEEEEcCCCCEEEEEecCCeEEEEeC
Q 018806 250 -IRRGFGGLSILKWSPTGDYFFAAKFDGTFYLWET 283 (350)
Q Consensus 250 -~~~~~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~ 283 (350)
..-+..++.--.|+..++.-+.+..|+-..+|..
T Consensus 624 k~~lGt~P~~Lr~f~sk~~t~vfa~sdrP~viY~~ 658 (1096)
T KOG1897|consen 624 KVTLGTQPISLRTFSSKSRTAVFALSDRPTVIYSS 658 (1096)
T ss_pred ccccCCCCcEEEEEeeCCceEEEEeCCCCEEEEec
Confidence 2223456665667665554444444665556644
No 489
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=72.08 E-value=9.4 Score=19.79 Aligned_cols=22 Identities=23% Similarity=0.326 Sum_probs=18.3
Q ss_pred EEEEEecCCeEEEEeCCCCcee
Q 018806 268 YFFAAKFDGTFYLWETNTWTSE 289 (350)
Q Consensus 268 ~l~~~~~d~~v~iwd~~~~~~~ 289 (350)
.++.++.++.++.+|.++|+..
T Consensus 8 ~v~~~~~~g~l~a~d~~~G~~~ 29 (33)
T smart00564 8 TVYVGSTDGTLYALDAKTGEIL 29 (33)
T ss_pred EEEEEcCCCEEEEEEcccCcEE
Confidence 5777888999999999888764
No 490
>PRK13613 lipoprotein LpqB; Provisional
Probab=72.02 E-value=96 Score=29.79 Aligned_cols=159 Identities=9% Similarity=0.100 Sum_probs=86.4
Q ss_pred CeeEEEEeeCCCeEEEEecCC-cEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCC
Q 018806 146 DVKVLEWRPNGGRSLSVGCKG-GICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDG 224 (350)
Q Consensus 146 ~v~~~~~sp~~~~l~~~~~d~-~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g 224 (350)
.+.+++.++++..+++...++ .+++..+........ . ....+. ....+..+|.++|
T Consensus 364 ~~~s~avS~~g~~~A~v~~~~~~l~vg~~~~~~~~~~-~-------------------~~~~~~---~~~Lt~PS~d~~g 420 (599)
T PRK13613 364 PLRRVAVSRDESRAAGISADGDSVYVGSLTPGASIGV-H-------------------SWGVTA---DGRLTSPSWDGRG 420 (599)
T ss_pred CccceEEcCCCceEEEEcCCCcEEEEeccCCCCcccc-c-------------------cceeec---cCcccCCcCcCCC
Confidence 678899999987777776654 455544431211000 0 000111 1345666777766
Q ss_pred CeEEEEEe-CCC--eEEEEeCCCCCceeee--ecC-CCeEEEEEcCCCCEEEEEec---CCeEEEEeCC---CCce----
Q 018806 225 RYLASASY-ESS--SFTIWDVAQGLGTPIR--RGF-GGLSILKWSPTGDYFFAAKF---DGTFYLWETN---TWTS---- 288 (350)
Q Consensus 225 ~~l~~~~~-d~g--~i~iwd~~~~~~~~~~--~~~-~~v~~~~~sp~g~~l~~~~~---d~~v~iwd~~---~~~~---- 288 (350)
.+-+... ..| .+++..- +++...+. ... ..|..+..|+||-.++.... .+.|+|=-+. .+..
T Consensus 421 -~vWtvd~~~~~~~vl~v~~~-~G~~~~V~~~~l~g~~I~~lrvSrDG~RvAvv~~~~g~~~v~va~V~R~~~G~~~l~~ 498 (599)
T PRK13613 421 -DLWVVDRDPADPRLLWLLQG-DGEPVEVRTPELDGHRVVAVRVARDGVRVALIVEKDGRRSLQIGRIVRDAKAVVSVEE 498 (599)
T ss_pred -CEEEecCCCCCceEEEEEcC-CCcEEEeeccccCCCEeEEEEECCCccEEEEEEecCCCcEEEEEEEEeCCCCcEEeec
Confidence 3433322 111 2444442 33332221 122 37999999999998876543 2455554332 2321
Q ss_pred -eccccCCCCeEEEEEcCCCCEEEEEE--CCCeEEEEEEeCCCC
Q 018806 289 -EPWSSTSGFVTGATWDPEGRMILLAF--AGSLTLGSIHFASKP 329 (350)
Q Consensus 289 -~~~~~~~~~v~~~~~s~~g~~l~~~~--~~~~~~~~~~~~~~~ 329 (350)
..+......+.+++|..++.+++.+. ++...++.+.+....
T Consensus 499 ~~~l~~~l~~v~~~~W~~~~sL~Vlg~~~~~~~~v~~v~vdG~~ 542 (599)
T PRK13613 499 FRSLAPELEDVTDMSWAGDSQLVVLGREEGGVQQARYVQVDGST 542 (599)
T ss_pred cEEeccCCCccceeEEcCCCEEEEEeccCCCCcceEEEecCCcC
Confidence 12222233589999999999877663 334678888877543
No 491
>PF01436 NHL: NHL repeat; InterPro: IPR001258 The NHL repeat, named after NCL-1, HT2A and Lin-41, is found largely in a large number of eukaryotic and prokaryotic proteins. For example, the repeat is found in a variety of enzymes of the copper type II, ascorbate-dependent monooxygenase family which catalyse the C terminus alpha-amidation of biological peptides []. In many it occurs in tandem arrays, for example in the ringfinger beta-box, coiled-coil (RBCC) eukaryotic growth regulators []. The 'Brain Tumor' protein (Brat) is one such growth regulator that contains a 6-bladed NHL-repeat beta-propeller [, ]. The NHL repeats are also found in serine/threonine protein kinase (STPK) in diverse range of pathogenic bacteria. These STPK are transmembrane receptors with a intracellular N-terminal kinase domain and extracellular C-terminal sensor domain. In the STPK, PknD, from Mycobacterium tuberculosis, the sensor domain forms a rigid, six-bladed b-propeller composed of NHL repeats with a flexible tether to the transmembrane domain.; GO: 0005515 protein binding; PDB: 3FVZ_A 3FW0_A 1RWL_A 1RWI_A 1Q7F_A.
Probab=71.60 E-value=11 Score=18.97 Aligned_cols=25 Identities=8% Similarity=0.101 Sum_probs=15.6
Q ss_pred eEEEEEcCCCCEEEEEecCCeEEEE
Q 018806 257 LSILKWSPTGDYFFAAKFDGTFYLW 281 (350)
Q Consensus 257 v~~~~~sp~g~~l~~~~~d~~v~iw 281 (350)
...++.+++|+.+++-.....|++|
T Consensus 4 P~gvav~~~g~i~VaD~~n~rV~vf 28 (28)
T PF01436_consen 4 PHGVAVDSDGNIYVADSGNHRVQVF 28 (28)
T ss_dssp EEEEEEETTSEEEEEECCCTEEEEE
T ss_pred CcEEEEeCCCCEEEEECCCCEEEEC
Confidence 4566777777666666556666554
No 492
>PRK13614 lipoprotein LpqB; Provisional
Probab=71.43 E-value=96 Score=29.55 Aligned_cols=193 Identities=13% Similarity=0.111 Sum_probs=101.5
Q ss_pred cCeeEEEEecCCCEEEEEECCCeEEEEEccCCCCCceeEecCCCCCCeeEEEEeeCCCeEEEEecCC--cEEEEecCCCC
Q 018806 100 VDLQGVSWHQHKHIVAFISGSTQVIVRDYEDSEGKDACILTSDSQRDVKVLEWRPNGGRSLSVGCKG--GICIWAPSYPG 177 (350)
Q Consensus 100 ~~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~~~~~~~~~~~~~~~~v~~~~~sp~~~~l~~~~~d~--~v~iwd~~~~~ 177 (350)
..+.+++.+++++.+|....++. .+|-... +........ ...++...|.++| .+-++..+. .+....-....
T Consensus 343 ~~~~s~avS~~g~~~A~~~~~~~-~l~~~~~--g~~~~~~~~--g~~Lt~PS~d~~g-~vWtv~~g~~~~vv~~~~~g~~ 416 (573)
T PRK13614 343 LGPASPAESPVSQTVAFLNGSRT-TLYTVSP--GQPARALTS--GSTLTRPSFSPQD-WVWTAGPGGNGRIVAYRPTGVA 416 (573)
T ss_pred ccccceeecCCCceEEEecCCCc-EEEEecC--CCcceeeec--CCCccCCcccCCC-CEEEeeCCCCceEEEEecCCCc
Confidence 37889999999999998877662 3443321 222233322 3457888888885 444443332 33333221111
Q ss_pred CCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCCCCeEEEEEeCCCe--EEEEeC---CCCCceeee-
Q 018806 178 NAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPDGRYLASASYESSS--FTIWDV---AQGLGTPIR- 251 (350)
Q Consensus 178 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~g~~l~~~~~d~g~--i~iwd~---~~~~~~~~~- 251 (350)
........ ... ........|..+..|+||-.++.....+|. |.+=-+ ..|....+.
T Consensus 417 ~~~~~~~~-----------------~v~-~~~l~g~~I~~lrvSrDG~R~Avi~~~~g~~~V~va~V~R~~~G~P~~L~~ 478 (573)
T PRK13614 417 EGAQAPTV-----------------TLT-ADWLAGRTVKELRVSREGVRALVISEQNGKSRVQVAGIVRNEDGTPRELTA 478 (573)
T ss_pred ccccccce-----------------eec-ccccCCCeeEEEEECCCccEEEEEEEeCCccEEEEEEEEeCCCCCeEEccC
Confidence 10000000 000 011112359999999999988765533344 655322 234322221
Q ss_pred ----ecCCCeEEEEEcCCCCEEEEEe---cCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCCEEEEEECCC
Q 018806 252 ----RGFGGLSILKWSPTGDYFFAAK---FDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGRMILLAFAGS 317 (350)
Q Consensus 252 ----~~~~~v~~~~~sp~g~~l~~~~---~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~~l~~~~~~~ 317 (350)
.....+.++.|..++.+++.+. .+..+++..+..+....+. .-..+..|+=..+.+.|+...++.
T Consensus 479 ~~~~~~~~~~~sl~W~~~~sl~V~~~~~~~~~~~~~v~v~~g~~~~l~-~~~~~~~iaag~~~~~i~~~sd~~ 550 (573)
T PRK13614 479 PITLAADSDADTGAWVGDSTVVVTKASATSNVVPELLSVDAGQPQQLA-PWTGLTSITVGNGPEEVYGQSDGG 550 (573)
T ss_pred ceecccCCCcceeEEcCCCEEEEEeccCCCcceEEEEEeCCCCcccCC-CcCCeEEEeecCCccceEEEcCCC
Confidence 1235788999999998766553 2346778888655543333 323355555444333444444433
No 493
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=70.13 E-value=1.2e+02 Score=30.20 Aligned_cols=118 Identities=12% Similarity=0.120 Sum_probs=68.7
Q ss_pred ccCeeEEEEecC-CCEEEEEECCCeEEEEEccCCCC--CceeEecCCCCC----------CeeEEEEeeCCCeEEEEecC
Q 018806 99 EVDLQGVSWHQH-KHIVAFISGSTQVIVRDYEDSEG--KDACILTSDSQR----------DVKVLEWRPNGGRSLSVGCK 165 (350)
Q Consensus 99 ~~~V~~v~~sp~-g~~la~~s~d~~i~iw~~~~~~~--~~~~~~~~~~~~----------~v~~~~~sp~~~~l~~~~~d 165 (350)
+.+...++|+|. .+.||.....|...||++..... .........+.+ .-..+.|.++-..++. ...
T Consensus 145 g~~~aDv~FnP~~~~q~AiVD~~G~Wsvw~i~~~~~~~~~~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~lLv-~~r 223 (765)
T PF10214_consen 145 GFPHADVAFNPWDQRQFAIVDEKGNWSVWDIKGRPKRKSSNLRLSRNISGSIIFDPEELSNWKRILWVSDSNRLLV-CNR 223 (765)
T ss_pred CCccceEEeccCccceEEEEeccCcEEEEEeccccccCCcceeeccCCCccccCCCcccCcceeeEecCCCCEEEE-EcC
Confidence 457889999984 47899999999999999921111 111111111122 2347889877555554 455
Q ss_pred CcEEEEecCCCCCCceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECCC--CCeEEEEEeCCCeEEEEeCC
Q 018806 166 GGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGPD--GRYLASASYESSSFTIWDVA 243 (350)
Q Consensus 166 ~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp~--g~~l~~~~~d~g~i~iwd~~ 243 (350)
..+.++|++.......+. .......|.++.-+|. +..++.. .. .|...++.
T Consensus 224 ~~l~~~d~~~~~~~~~l~------------------------~~~~~~~IlDv~~~~~~~~~~FiLT-s~--eiiw~~~~ 276 (765)
T PF10214_consen 224 SKLMLIDFESNWQTEYLV------------------------TAKTWSWILDVKRSPDNPSHVFILT-SK--EIIWLDVK 276 (765)
T ss_pred CceEEEECCCCCccchhc------------------------cCCChhheeeEEecCCccceEEEEe-cC--eEEEEEcc
Confidence 677888888443322111 1112257788888776 3333332 22 67777877
Q ss_pred C
Q 018806 244 Q 244 (350)
Q Consensus 244 ~ 244 (350)
.
T Consensus 277 ~ 277 (765)
T PF10214_consen 277 S 277 (765)
T ss_pred C
Confidence 6
No 494
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=65.82 E-value=19 Score=34.71 Aligned_cols=55 Identities=15% Similarity=0.137 Sum_probs=37.8
Q ss_pred CCCeEEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccccCCCCeEEEEEcCCCC
Q 018806 254 FGGLSILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWSSTSGFVTGATWDPEGR 308 (350)
Q Consensus 254 ~~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~~~~~~v~~~~~s~~g~ 308 (350)
...+.++.-+|.|+.++.++.||+|.+|+.-......+.....+-..+.|...|-
T Consensus 14 ~e~~~aiqshp~~~s~v~~~~d~si~lfn~~~r~qski~~~~~p~~nlv~tnhgl 68 (1636)
T KOG3616|consen 14 DEFTTAIQSHPGGQSFVLAHQDGSIILFNFIPRRQSKICEEAKPKENLVFTNHGL 68 (1636)
T ss_pred cceeeeeeecCCCceEEEEecCCcEEEEeecccchhhhhhhcCCccceeeeccce
Confidence 3456778888999999999999999999987655433333333444455555443
No 495
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=65.36 E-value=90 Score=26.90 Aligned_cols=201 Identities=16% Similarity=0.204 Sum_probs=104.2
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEccCC-----CCCceeEecC--C--CCCCeeEEEEeeCC------------CeE
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDYEDS-----EGKDACILTS--D--SQRDVKVLEWRPNG------------GRS 159 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~~~~-----~~~~~~~~~~--~--~~~~v~~~~~sp~~------------~~l 159 (350)
.-+.|+++|.+.+-++...-+...+||.+.. .......+.. + .....+.+.|+... ..+
T Consensus 24 N~WGia~~p~~~~WVadngT~~~TlYdg~~~~~~g~~~~L~vtiP~~~~~~~~~~PTGiVfN~~~~F~vt~~g~~~~a~F 103 (336)
T TIGR03118 24 NAWGLSYRPGGPFWVANTGTGTATLYVGNPDTQPLVQDPLVVVIPAPPPLAAEGTPTGQVFNGSDTFVVSGEGITGPSRF 103 (336)
T ss_pred ccceeEecCCCCEEEecCCcceEEeecCCcccccCCccceEEEecCCCCCCCCCCccEEEEeCCCceEEcCCCcccceeE
Confidence 3688999999988877777888999998611 1111222221 1 22456777776432 235
Q ss_pred EEEecCCcEEEEecCCCCC---CceeecccccccceecCCCCCceEEeeeccCCCCCceeeEEECC--CCCeEEEEEeCC
Q 018806 160 LSVGCKGGICIWAPSYPGN---AASVRSGAASFLGALSRGPGTRWTLVDFLRSQNGEQITALSWGP--DGRYLASASYES 234 (350)
Q Consensus 160 ~~~~~d~~v~iwd~~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~sp--~g~~l~~~~~d~ 234 (350)
+.++.||+|.-|....... ...+ ..+ .+....-...+++.. .+.+|+.+...+
T Consensus 104 if~tEdGTisaW~p~v~~t~~~~~~~--------------------~~d--~s~~gavYkGLAi~~~~~~~~LYaadF~~ 161 (336)
T TIGR03118 104 LFVTEDGTLSGWAPALGTTRMTRAEI--------------------VVD--ASQQGNVYKGLAVGPTGGGDYLYAANFRQ 161 (336)
T ss_pred EEEeCCceEEeecCcCCcccccccEE--------------------EEc--cCCCcceeeeeEEeecCCCceEEEeccCC
Confidence 6777889999998542221 0000 000 011112334555553 367777777666
Q ss_pred CeEEEEeCCCCCceeeee---------cCCC--e---------EEEEEcCCCCEEEEEecCCeEEEEeCCCCceeccc--
Q 018806 235 SSFTIWDVAQGLGTPIRR---------GFGG--L---------SILKWSPTGDYFFAAKFDGTFYLWETNTWTSEPWS-- 292 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~---------~~~~--v---------~~~~~sp~g~~l~~~~~d~~v~iwd~~~~~~~~~~-- 292 (350)
|+|.+||-.=.+.. +.. .-.+ | +-..-.++++.=+.+..-|.|-+||+...-.+++.
T Consensus 162 g~IDVFd~~f~~~~-~~g~F~DP~iPagyAPFnIqnig~~lyVtYA~qd~~~~d~v~G~G~G~VdvFd~~G~l~~r~as~ 240 (336)
T TIGR03118 162 GRIDVFKGSFRPPP-LPGSFIDPALPAGYAPFNVQNLGGTLYVTYAQQDADRNDEVAGAGLGYVNVFTLNGQLLRRVASS 240 (336)
T ss_pred CceEEecCcccccc-CCCCccCCCCCCCCCCcceEEECCeEEEEEEecCCcccccccCCCcceEEEEcCCCcEEEEeccC
Confidence 89999985433211 100 0000 1 11111222222223334478999998754444442
Q ss_pred cCCCCeEEEEEcC------CCCEEEEEECCCeEEEEEEe
Q 018806 293 STSGFVTGATWDP------EGRMILLAFAGSLTLGSIHF 325 (350)
Q Consensus 293 ~~~~~v~~~~~s~------~g~~l~~~~~~~~~~~~~~~ 325 (350)
+.-...+.|+..| .|.+| ++.-++.+|-..+.
T Consensus 241 g~LNaPWG~a~APa~FG~~sg~lL-VGNFGDG~InaFD~ 278 (336)
T TIGR03118 241 GRLNAPWGLAIAPESFGSLSGALL-VGNFGDGTINAYDP 278 (336)
T ss_pred CcccCCceeeeChhhhCCCCCCeE-EeecCCceeEEecC
Confidence 2234457777755 34444 46644555555554
No 496
>PLN02193 nitrile-specifier protein
Probab=65.10 E-value=1.2e+02 Score=28.17 Aligned_cols=67 Identities=6% Similarity=0.060 Sum_probs=36.9
Q ss_pred CCCeEEEEEeCC----CeEEEEeCCCCCceeeeec------CCCeEEEEEcCCCCEEEEEecC----CeEEEEeCCCCce
Q 018806 223 DGRYLASASYES----SSFTIWDVAQGLGTPIRRG------FGGLSILKWSPTGDYFFAAKFD----GTFYLWETNTWTS 288 (350)
Q Consensus 223 ~g~~l~~~~~d~----g~i~iwd~~~~~~~~~~~~------~~~v~~~~~sp~g~~l~~~~~d----~~v~iwd~~~~~~ 288 (350)
+++.++.++.+. ..+..||+.+.+...+... ......+ .-+++.++.++.+ ..+.+||+.+.+-
T Consensus 278 ~~~iYv~GG~~~~~~~~~~~~yd~~t~~W~~~~~~~~~~~~R~~~~~~--~~~gkiyviGG~~g~~~~dv~~yD~~t~~W 355 (470)
T PLN02193 278 EENVYVFGGVSATARLKTLDSYNIVDKKWFHCSTPGDSFSIRGGAGLE--VVQGKVWVVYGFNGCEVDDVHYYDPVQDKW 355 (470)
T ss_pred CCEEEEECCCCCCCCcceEEEEECCCCEEEeCCCCCCCCCCCCCcEEE--EECCcEEEEECCCCCccCceEEEECCCCEE
Confidence 455666665431 1577888877654332210 1111112 2356776766654 4689999988766
Q ss_pred ecc
Q 018806 289 EPW 291 (350)
Q Consensus 289 ~~~ 291 (350)
..+
T Consensus 356 ~~~ 358 (470)
T PLN02193 356 TQV 358 (470)
T ss_pred EEe
Confidence 443
No 497
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=64.59 E-value=34 Score=33.76 Aligned_cols=80 Identities=14% Similarity=0.062 Sum_probs=45.6
Q ss_pred CeEEEEeCCCCCceeeeecC----C---------------CeEEEEEcCCCCEEEE-EecCCeEEEEeCCCCceeccc--
Q 018806 235 SSFTIWDVAQGLGTPIRRGF----G---------------GLSILKWSPTGDYFFA-AKFDGTFYLWETNTWTSEPWS-- 292 (350)
Q Consensus 235 g~i~iwd~~~~~~~~~~~~~----~---------------~v~~~~~sp~g~~l~~-~~~d~~v~iwd~~~~~~~~~~-- 292 (350)
|.|.-+|+++++........ . +...=...-.|..++. ++.|+.++-+|.++|+..-..
T Consensus 641 G~l~AiDl~tGk~~W~~~~g~~~~~~p~~~~~~~~~~~g~p~~gG~l~TagglvF~~gt~d~~l~A~D~~tGk~lW~~~l 720 (764)
T TIGR03074 641 GYMAAIDLKTGKVVWQHPNGTVRDTGPMGIRMPLPIPIGVPTLGGPLATAGGLVFIGATQDNYLRAYDLSTGKELWKARL 720 (764)
T ss_pred EEEEEEECCCCcEeeeeECCccccccccccccccccccCCcccCCcEEEcCCEEEEEeCCCCEEEEEECCCCceeeEeeC
Confidence 68889999998765433221 0 0101111224566665 678999999999999984222
Q ss_pred cCCCCeEEEEEc-CCCCE-EEEEE
Q 018806 293 STSGFVTGATWD-PEGRM-ILLAF 314 (350)
Q Consensus 293 ~~~~~v~~~~~s-~~g~~-l~~~~ 314 (350)
.....-.-+.|. .+|++ |++..
T Consensus 721 ~~~~~a~P~tY~~~~GkQYVvi~a 744 (764)
T TIGR03074 721 PAGGQATPMTYMGKDGKQYVVIVA 744 (764)
T ss_pred CCCcccCCEEEEecCCEEEEEEEe
Confidence 112222334565 57765 44443
No 498
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=64.51 E-value=25 Score=29.11 Aligned_cols=81 Identities=16% Similarity=0.146 Sum_probs=49.6
Q ss_pred eEEEEeCCCCCceeeeec-CCCeEEEEEcCCCCEEEEEec-C--CeEEEEeCCC-Cceecc------ccCCCCeEEEEEc
Q 018806 236 SFTIWDVAQGLGTPIRRG-FGGLSILKWSPTGDYFFAAKF-D--GTFYLWETNT-WTSEPW------SSTSGFVTGATWD 304 (350)
Q Consensus 236 ~i~iwd~~~~~~~~~~~~-~~~v~~~~~sp~g~~l~~~~~-d--~~v~iwd~~~-~~~~~~------~~~~~~v~~~~~s 304 (350)
.-.+||+.+++...+... +....+-.+-+||++|.+|+. + ..+++++..+ .....+ .....+--+..--
T Consensus 47 ~s~~yD~~tn~~rpl~v~td~FCSgg~~L~dG~ll~tGG~~~G~~~ir~~~p~~~~~~~~w~e~~~~m~~~RWYpT~~~L 126 (243)
T PF07250_consen 47 HSVEYDPNTNTFRPLTVQTDTFCSGGAFLPDGRLLQTGGDNDGNKAIRIFTPCTSDGTCDWTESPNDMQSGRWYPTATTL 126 (243)
T ss_pred EEEEEecCCCcEEeccCCCCCcccCcCCCCCCCEEEeCCCCccccceEEEecCCCCCCCCceECcccccCCCccccceEC
Confidence 445788888876654432 223334567799999988865 3 3688888654 111111 1223344455667
Q ss_pred CCCCEEEEEECC
Q 018806 305 PEGRMILLAFAG 316 (350)
Q Consensus 305 ~~g~~l~~~~~~ 316 (350)
|||+.|++|+..
T Consensus 127 ~DG~vlIvGG~~ 138 (243)
T PF07250_consen 127 PDGRVLIVGGSN 138 (243)
T ss_pred CCCCEEEEeCcC
Confidence 899999998744
No 499
>KOG1983 consensus Tomosyn and related SNARE-interacting proteins [Intracellular trafficking, secretion, and vesicular transport]
Probab=63.98 E-value=68 Score=32.90 Aligned_cols=28 Identities=4% Similarity=0.119 Sum_probs=24.6
Q ss_pred CeeEEEEecCCCEEEEEECCCeEEEEEc
Q 018806 101 DLQGVSWHQHKHIVAFISGSTQVIVRDY 128 (350)
Q Consensus 101 ~V~~v~~sp~g~~la~~s~d~~i~iw~~ 128 (350)
....++|+|..+++|.+...|.++++-.
T Consensus 37 ~~~~~afD~~q~llai~t~tg~i~~yg~ 64 (993)
T KOG1983|consen 37 TPSALAFDPTQGLLAIGTRTGAIKIYGQ 64 (993)
T ss_pred CCcceeeccccceEEEEEecccEEEecc
Confidence 3566899999999999999999999875
No 500
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=63.52 E-value=95 Score=26.55 Aligned_cols=200 Identities=14% Similarity=0.132 Sum_probs=102.9
Q ss_pred eeEEEEecCCCEEEE--EEC----------CCeEEEEEccCCCCCceeEecCC-----CCCCeeEEEEeeCCC----eEE
Q 018806 102 LQGVSWHQHKHIVAF--ISG----------STQVIVRDYEDSEGKDACILTSD-----SQRDVKVLEWRPNGG----RSL 160 (350)
Q Consensus 102 V~~v~~sp~g~~la~--~s~----------d~~i~iw~~~~~~~~~~~~~~~~-----~~~~v~~~~~sp~~~----~l~ 160 (350)
|..+...+++++=+. |.. .-+|.+||+.+ .+.+..+... ....+..+.+..... .++
T Consensus 3 V~~v~iD~~~rLWVlD~G~~~~~~~~~~~~~pKLv~~Dl~t--~~li~~~~~p~~~~~~~s~lndl~VD~~~~~~~~~~a 80 (287)
T PF03022_consen 3 VQRVQIDECGRLWVLDSGRPNGLQPPKQVCPPKLVAFDLKT--NQLIRRYPFPPDIAPPDSFLNDLVVDVRDGNCDDGFA 80 (287)
T ss_dssp EEEEEE-TTSEEEEEE-CCHSSSSTTGHTS--EEEEEETTT--TCEEEEEE--CCCS-TCGGEEEEEEECTTTTS-SEEE
T ss_pred ccEEEEcCCCCEEEEeCCCcCCCCCCCCCCCcEEEEEECCC--CcEEEEEECChHHcccccccceEEEEccCCCCcceEE
Confidence 566666666654333 210 12566777754 4444443222 245677888876322 455
Q ss_pred EEec--CCcEEEEecCCCCCCceeecccccccceecCCCCCceEEee-eccCCCCCceeeEEECC---CCCeEEEEEeCC
Q 018806 161 SVGC--KGGICIWAPSYPGNAASVRSGAASFLGALSRGPGTRWTLVD-FLRSQNGEQITALSWGP---DGRYLASASYES 234 (350)
Q Consensus 161 ~~~~--d~~v~iwd~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~v~~~~~sp---~g~~l~~~~~d~ 234 (350)
+.+. .+.+-|+|+..+. ...+......+... ...+.... .+.- ...+..++.+| +|+.|+.....+
T Consensus 81 YItD~~~~glIV~dl~~~~-s~Rv~~~~~~~~p~-----~~~~~i~g~~~~~--~dg~~gial~~~~~d~r~LYf~~lss 152 (287)
T PF03022_consen 81 YITDSGGPGLIVYDLATGK-SWRVLHNSFSPDPD-----AGPFTIGGESFQW--PDGIFGIALSPISPDGRWLYFHPLSS 152 (287)
T ss_dssp EEEETTTCEEEEEETTTTE-EEEEETCGCTTS-S-----SEEEEETTEEEEE--TTSEEEEEE-TTSTTS-EEEEEETT-
T ss_pred EEeCCCcCcEEEEEccCCc-EEEEecCCcceecc-----ccceeccCceEec--CCCccccccCCCCCCccEEEEEeCCC
Confidence 5444 3689999998433 23332222111110 00000000 1111 13477888876 788898887663
Q ss_pred CeEEEEeCCCC-----C---------ceeeeecC-CCeEEEEEcCCCCEEEEEecCCeEEEEeCCCC----ceeccccC-
Q 018806 235 SSFTIWDVAQG-----L---------GTPIRRGF-GGLSILKWSPTGDYFFAAKFDGTFYLWETNTW----TSEPWSST- 294 (350)
Q Consensus 235 g~i~iwd~~~~-----~---------~~~~~~~~-~~v~~~~~sp~g~~l~~~~~d~~v~iwd~~~~----~~~~~~~~- 294 (350)
-++|.+.+. . .....+.. .....++++++|.+.++--..+.|..|+..+. ....+...
T Consensus 153 --~~ly~v~T~~L~~~~~~~~~~~~~~v~~lG~k~~~s~g~~~D~~G~ly~~~~~~~aI~~w~~~~~~~~~~~~~l~~d~ 230 (287)
T PF03022_consen 153 --RKLYRVPTSVLRDPSLSDAQALASQVQDLGDKGSQSDGMAIDPNGNLYFTDVEQNAIGCWDPDGPYTPENFEILAQDP 230 (287)
T ss_dssp --SEEEEEEHHHHCSTT--HHH-HHHT-EEEEE---SECEEEEETTTEEEEEECCCTEEEEEETTTSB-GCCEEEEEE-C
T ss_pred --CcEEEEEHHHhhCccccccccccccceeccccCCCCceEEECCCCcEEEecCCCCeEEEEeCCCCcCccchheeEEcC
Confidence 344443321 1 11222222 35667899999988888888999999999862 22222221
Q ss_pred --CCCeEEEEEcC--CCCEEEEE
Q 018806 295 --SGFVTGATWDP--EGRMILLA 313 (350)
Q Consensus 295 --~~~v~~~~~s~--~g~~l~~~ 313 (350)
-..+.++.+.+ +|.+.+.+
T Consensus 231 ~~l~~pd~~~i~~~~~g~L~v~s 253 (287)
T PF03022_consen 231 RTLQWPDGLKIDPEGDGYLWVLS 253 (287)
T ss_dssp C-GSSEEEEEE-T--TS-EEEEE
T ss_pred ceeeccceeeeccccCceEEEEE
Confidence 34678899998 77766655
Done!