Query 002446
Match_columns 921
No_of_seqs 399 out of 2357
Neff 5.7
Searched_HMMs 46136
Date Fri Mar 29 00:09:19 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/002446.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/002446hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PF12490 BCAS3: Breast carcino 100.0 1.5E-60 3.3E-65 509.5 16.5 241 546-787 1-251 (251)
2 KOG2109 WD40 repeat protein [G 100.0 1.6E-59 3.5E-64 530.8 18.6 641 48-801 2-653 (788)
3 KOG2110 Uncharacterized conser 100.0 1.9E-34 4.2E-39 311.3 33.0 243 86-501 3-250 (391)
4 KOG2111 Uncharacterized conser 100.0 3E-32 6.4E-37 290.0 27.7 250 87-501 4-258 (346)
5 KOG0271 Notchless-like WD40 re 99.9 2.8E-24 6.1E-29 232.9 19.5 292 86-515 155-455 (480)
6 KOG0263 Transcription initiati 99.9 1.6E-21 3.4E-26 227.1 22.1 239 91-504 381-654 (707)
7 KOG0272 U4/U6 small nuclear ri 99.9 1.6E-21 3.5E-26 214.0 19.7 256 86-515 173-434 (459)
8 KOG0271 Notchless-like WD40 re 99.9 3.5E-21 7.5E-26 209.1 21.4 256 84-515 111-413 (480)
9 KOG0315 G-protein beta subunit 99.9 2.3E-20 4.9E-25 194.1 25.5 275 108-511 12-300 (311)
10 KOG0318 WD40 repeat stress pro 99.9 7.1E-20 1.5E-24 205.2 30.4 405 26-545 113-590 (603)
11 cd00200 WD40 WD40 domain, foun 99.8 4.8E-18 1E-22 173.6 32.3 251 86-512 7-262 (289)
12 KOG0272 U4/U6 small nuclear ri 99.8 6.6E-20 1.4E-24 201.5 16.5 242 83-497 212-458 (459)
13 cd00200 WD40 WD40 domain, foun 99.8 1.7E-17 3.7E-22 169.6 32.1 237 86-497 49-289 (289)
14 KOG0291 WD40-repeat-containing 99.8 4.2E-18 9.2E-23 197.1 27.3 248 89-510 308-561 (893)
15 KOG0295 WD40 repeat-containing 99.8 2.6E-18 5.6E-23 186.3 20.4 255 84-498 146-405 (406)
16 PLN00181 protein SPA1-RELATED; 99.8 6.8E-17 1.5E-21 199.4 33.2 235 108-498 547-792 (793)
17 KOG0273 Beta-transducin family 99.8 4.7E-17 1E-21 181.0 28.3 282 87-499 234-523 (524)
18 KOG0286 G-protein beta subunit 99.8 1.1E-16 2.5E-21 169.8 29.4 260 83-515 50-319 (343)
19 KOG0279 G protein beta subunit 99.8 5.2E-17 1.1E-21 171.6 26.3 253 83-508 10-271 (315)
20 KOG0266 WD40 repeat-containing 99.8 1E-16 2.2E-21 186.2 30.0 251 87-511 158-421 (456)
21 KOG0265 U5 snRNP-specific prot 99.8 3.4E-17 7.4E-22 174.3 22.9 271 74-515 35-312 (338)
22 KOG0273 Beta-transducin family 99.8 5E-17 1.1E-21 180.8 24.4 198 206-510 257-493 (524)
23 KOG0295 WD40 repeat-containing 99.8 2E-17 4.3E-22 179.5 20.1 252 85-512 105-377 (406)
24 PLN00181 protein SPA1-RELATED; 99.8 6E-16 1.3E-20 191.0 35.6 251 83-501 478-740 (793)
25 KOG0263 Transcription initiati 99.8 2.4E-17 5.3E-22 192.4 20.4 116 383-515 508-623 (707)
26 KOG0266 WD40 repeat-containing 99.7 1.8E-16 3.8E-21 184.3 25.6 190 206-513 181-378 (456)
27 KOG0278 Serine/threonine kinas 99.7 4.7E-17 1E-21 169.6 15.9 199 86-443 98-299 (334)
28 KOG0281 Beta-TrCP (transducin 99.7 1.2E-17 2.5E-22 179.9 10.3 231 87-503 196-432 (499)
29 KOG0315 G-protein beta subunit 99.7 5.1E-16 1.1E-20 162.0 22.0 227 205-511 19-258 (311)
30 KOG1446 Histone H3 (Lys4) meth 99.7 6.5E-15 1.4E-19 158.2 30.9 250 87-509 13-272 (311)
31 KOG0319 WD40-repeat-containing 99.7 3.9E-16 8.6E-21 180.9 23.1 116 382-514 477-592 (775)
32 KOG0274 Cdc4 and related F-box 99.7 7.4E-16 1.6E-20 181.5 25.1 242 84-507 245-490 (537)
33 KOG0284 Polyadenylation factor 99.7 4.7E-17 1E-21 178.5 13.5 251 88-514 96-353 (464)
34 KOG0268 Sof1-like rRNA process 99.7 7.1E-17 1.5E-21 175.1 14.4 282 75-501 54-347 (433)
35 KOG0276 Vesicle coat complex C 99.7 1.2E-15 2.6E-20 174.0 24.5 190 206-516 35-232 (794)
36 KOG0643 Translation initiation 99.7 2.2E-15 4.8E-20 158.5 23.9 262 85-500 7-318 (327)
37 KOG0286 G-protein beta subunit 99.7 5.2E-15 1.1E-19 157.3 26.6 235 88-497 97-343 (343)
38 KOG0285 Pleiotropic regulator 99.7 1.2E-15 2.6E-20 165.3 21.2 240 84-501 147-391 (460)
39 KOG0319 WD40-repeat-containing 99.7 1.7E-15 3.7E-20 175.8 23.1 233 206-515 303-551 (775)
40 KOG0274 Cdc4 and related F-box 99.7 1.6E-15 3.4E-20 178.8 23.3 230 108-510 220-452 (537)
41 KOG0279 G protein beta subunit 99.7 1E-14 2.3E-19 154.3 26.8 224 108-500 77-314 (315)
42 KOG0316 Conserved WD40 repeat- 99.7 3E-15 6.4E-20 155.3 20.9 251 85-513 14-271 (307)
43 KOG0276 Vesicle coat complex C 99.7 2.8E-15 6E-20 171.1 21.4 247 87-507 12-265 (794)
44 KOG1407 WD40 repeat protein [F 99.7 4.4E-15 9.6E-20 155.9 21.0 252 82-508 14-270 (313)
45 KOG0291 WD40-repeat-containing 99.7 1.7E-14 3.8E-19 167.5 27.7 265 83-509 345-622 (893)
46 PTZ00421 coronin; Provisional 99.7 5.1E-14 1.1E-18 165.0 32.1 223 116-503 51-294 (493)
47 KOG0306 WD40-repeat-containing 99.7 3.3E-15 7.1E-20 173.4 21.6 224 108-500 425-665 (888)
48 KOG0296 Angio-associated migra 99.7 5.3E-14 1.2E-18 153.2 28.9 289 83-499 101-398 (399)
49 KOG0288 WD40 repeat protein Ti 99.7 2.5E-15 5.3E-20 165.4 17.9 237 87-497 218-459 (459)
50 KOG0285 Pleiotropic regulator 99.7 2.8E-15 6E-20 162.5 17.8 188 206-515 173-364 (460)
51 KOG0310 Conserved WD40 repeat- 99.7 1.3E-14 2.8E-19 162.5 23.7 234 87-498 67-308 (487)
52 KOG0292 Vesicle coat complex C 99.7 4.2E-15 9.1E-20 174.4 20.6 275 87-507 8-288 (1202)
53 KOG0281 Beta-TrCP (transducin 99.6 1.1E-15 2.3E-20 165.0 13.3 240 85-501 234-479 (499)
54 KOG0647 mRNA export protein (c 99.6 1.3E-14 2.8E-19 155.0 21.3 263 54-488 38-312 (347)
55 KOG0282 mRNA splicing factor [ 99.6 7.6E-16 1.6E-20 172.1 11.9 264 83-515 209-478 (503)
56 KOG1036 Mitotic spindle checkp 99.6 3.9E-14 8.4E-19 151.8 20.7 230 86-489 52-294 (323)
57 TIGR03866 PQQ_ABC_repeats PQQ- 99.6 1.2E-12 2.7E-17 139.0 31.9 271 109-509 3-289 (300)
58 KOG2055 WD40 repeat protein [G 99.6 3.8E-14 8.3E-19 157.8 20.1 271 87-501 212-514 (514)
59 PTZ00420 coronin; Provisional 99.6 5.4E-13 1.2E-17 158.1 31.1 220 117-501 55-295 (568)
60 KOG0265 U5 snRNP-specific prot 99.6 1.5E-13 3.3E-18 146.8 23.1 222 107-496 103-335 (338)
61 KOG0318 WD40 repeat stress pro 99.6 3.2E-13 6.9E-18 152.4 26.5 108 384-507 164-273 (603)
62 KOG0288 WD40 repeat protein Ti 99.6 1.7E-14 3.6E-19 158.9 14.9 253 83-509 170-427 (459)
63 KOG0277 Peroxisomal targeting 99.6 6.3E-14 1.4E-18 146.9 17.7 231 115-510 37-277 (311)
64 KOG0264 Nucleosome remodeling 99.6 6.2E-14 1.4E-18 156.1 18.1 107 383-505 243-353 (422)
65 PTZ00420 coronin; Provisional 99.6 1.8E-12 3.9E-17 153.7 31.1 127 85-263 71-208 (568)
66 KOG1539 WD repeat protein [Gen 99.6 1.6E-12 3.6E-17 152.8 30.1 119 387-507 467-614 (910)
67 KOG1539 WD repeat protein [Gen 99.6 7.5E-13 1.6E-17 155.6 26.9 101 382-500 548-649 (910)
68 KOG0305 Anaphase promoting com 99.6 3.2E-13 7E-18 155.5 23.3 240 88-501 217-463 (484)
69 KOG0310 Conserved WD40 repeat- 99.6 1.6E-13 3.6E-18 153.8 20.0 246 86-507 24-276 (487)
70 KOG0641 WD40 repeat protein [G 99.6 2.7E-12 5.8E-17 132.6 27.1 257 84-499 85-349 (350)
71 KOG0973 Histone transcription 99.6 9.5E-14 2.1E-18 167.2 19.0 169 388-568 35-259 (942)
72 PTZ00421 coronin; Provisional 99.6 2.6E-12 5.6E-17 150.8 30.7 128 85-263 72-209 (493)
73 KOG0292 Vesicle coat complex C 99.5 1.2E-13 2.6E-18 162.4 18.3 202 206-515 31-254 (1202)
74 KOG2096 WD40 repeat protein [G 99.5 8.8E-13 1.9E-17 141.7 23.0 97 402-500 270-403 (420)
75 KOG0306 WD40-repeat-containing 99.5 6.9E-13 1.5E-17 154.4 23.6 316 21-515 309-638 (888)
76 KOG0645 WD40 repeat protein [G 99.5 2.6E-12 5.5E-17 136.0 25.3 205 131-499 8-225 (312)
77 KOG0284 Polyadenylation factor 99.5 6.5E-14 1.4E-18 154.1 13.6 229 108-504 151-385 (464)
78 KOG0313 Microtubule binding pr 99.5 1.6E-12 3.4E-17 142.5 23.5 116 385-515 276-393 (423)
79 KOG0316 Conserved WD40 repeat- 99.5 6.5E-13 1.4E-17 138.1 19.4 182 206-512 39-226 (307)
80 KOG0282 mRNA splicing factor [ 99.5 1E-13 2.3E-18 155.2 14.5 237 86-497 256-503 (503)
81 KOG0293 WD40 repeat-containing 99.5 4E-13 8.7E-18 148.0 18.2 281 85-501 221-515 (519)
82 KOG0278 Serine/threonine kinas 99.5 1.7E-12 3.7E-17 135.9 18.8 103 383-502 198-300 (334)
83 KOG0277 Peroxisomal targeting 99.5 1.3E-12 2.8E-17 137.2 17.8 251 83-498 44-308 (311)
84 KOG0973 Histone transcription 99.5 5.9E-12 1.3E-16 152.0 25.8 252 85-500 66-356 (942)
85 KOG0305 Anaphase promoting com 99.5 3.9E-12 8.4E-17 146.7 23.0 239 107-515 188-435 (484)
86 KOG0269 WD40 repeat-containing 99.5 2.9E-13 6.4E-18 158.0 13.2 113 387-515 196-313 (839)
87 KOG0313 Microtubule binding pr 99.5 7.3E-12 1.6E-16 137.3 23.0 225 108-501 161-420 (423)
88 KOG0645 WD40 repeat protein [G 99.5 6.3E-11 1.4E-15 125.6 29.2 240 82-501 8-263 (312)
89 KOG0640 mRNA cleavage stimulat 99.5 7.9E-13 1.7E-17 141.6 14.9 86 409-509 260-345 (430)
90 KOG0275 Conserved WD40 repeat- 99.4 1.7E-13 3.6E-18 147.0 8.3 110 384-510 279-389 (508)
91 KOG1274 WD40 repeat protein [G 99.4 1.7E-11 3.7E-16 145.7 25.9 241 86-500 11-263 (933)
92 KOG0643 Translation initiation 99.4 1.2E-11 2.6E-16 130.8 21.6 188 206-509 32-230 (327)
93 KOG0308 Conserved WD40 repeat- 99.4 5E-13 1.1E-17 153.8 11.5 188 206-513 47-257 (735)
94 KOG0264 Nucleosome remodeling 99.4 9.6E-12 2.1E-16 138.9 20.8 114 384-500 289-405 (422)
95 KOG0772 Uncharacterized conser 99.4 1E-11 2.3E-16 140.0 20.7 111 383-508 332-454 (641)
96 KOG0275 Conserved WD40 repeat- 99.4 8.4E-13 1.8E-17 141.7 10.9 206 205-515 234-483 (508)
97 KOG2445 Nuclear pore complex c 99.4 8.8E-11 1.9E-15 126.2 26.1 275 84-499 9-318 (361)
98 KOG1408 WD40 repeat protein [F 99.4 6.7E-12 1.5E-16 145.1 18.7 214 206-500 481-714 (1080)
99 KOG0772 Uncharacterized conser 99.4 2.4E-12 5.1E-17 145.1 14.6 113 382-507 283-402 (641)
100 KOG0289 mRNA splicing factor [ 99.4 2.9E-11 6.2E-16 134.4 22.4 226 108-499 233-462 (506)
101 KOG1407 WD40 repeat protein [F 99.4 6.8E-11 1.5E-15 124.8 23.9 222 98-490 69-293 (313)
102 KOG0308 Conserved WD40 repeat- 99.4 5E-12 1.1E-16 145.6 16.2 107 384-507 187-293 (735)
103 KOG0283 WD40 repeat-containing 99.4 2.4E-11 5.2E-16 143.8 20.9 176 203-501 387-578 (712)
104 TIGR03866 PQQ_ABC_repeats PQQ- 99.4 1.4E-10 3.1E-15 123.1 25.0 181 206-508 11-196 (300)
105 KOG0296 Angio-associated migra 99.4 1.1E-10 2.4E-15 127.7 23.9 133 206-443 86-222 (399)
106 KOG1446 Histone H3 (Lys4) meth 99.4 2.8E-10 6.1E-15 122.9 26.2 244 86-501 54-305 (311)
107 KOG2919 Guanine nucleotide-bin 99.3 7.5E-11 1.6E-15 127.4 20.9 123 390-529 230-355 (406)
108 KOG0299 U3 snoRNP-associated p 99.3 7.1E-11 1.5E-15 132.2 20.6 227 86-487 200-443 (479)
109 KOG0647 mRNA export protein (c 99.3 3.1E-10 6.8E-15 121.8 24.3 257 85-514 24-296 (347)
110 KOG0293 WD40 repeat-containing 99.3 2.6E-11 5.5E-16 134.0 14.9 240 83-442 264-514 (519)
111 KOG1273 WD40 repeat protein [G 99.3 1.7E-10 3.6E-15 124.3 20.2 257 91-509 26-290 (405)
112 KOG1408 WD40 repeat protein [F 99.3 1.7E-10 3.8E-15 133.7 21.5 311 107-510 270-637 (1080)
113 KOG1332 Vesicle coat complex C 99.3 1.2E-10 2.6E-15 122.0 17.9 265 84-503 7-290 (299)
114 KOG2106 Uncharacterized conser 99.3 7.9E-09 1.7E-13 116.9 33.4 312 88-507 154-485 (626)
115 KOG4283 Transcription-coupled 99.3 2.5E-10 5.4E-15 122.1 18.6 111 388-501 166-278 (397)
116 KOG0294 WD40 repeat-containing 99.3 9.7E-11 2.1E-15 126.2 15.6 132 382-515 99-253 (362)
117 KOG0301 Phospholipase A2-activ 99.3 3.6E-10 7.9E-15 131.4 21.2 214 108-500 73-289 (745)
118 KOG0639 Transducin-like enhanc 99.2 3.8E-10 8.3E-15 127.0 20.6 276 87-498 418-703 (705)
119 KOG1036 Mitotic spindle checkp 99.2 1.3E-09 2.7E-14 117.6 23.5 252 85-508 10-271 (323)
120 KOG0283 WD40 repeat-containing 99.2 7.8E-11 1.7E-15 139.5 15.7 111 381-510 381-492 (712)
121 KOG0639 Transducin-like enhanc 99.2 6.3E-11 1.4E-15 133.2 14.0 109 387-498 528-662 (705)
122 KOG2109 WD40 repeat protein [G 99.2 9.9E-12 2.2E-16 143.7 7.5 321 107-512 252-589 (788)
123 KOG4378 Nuclear protein COP1 [ 99.2 1.2E-10 2.7E-15 130.8 15.6 115 383-515 180-297 (673)
124 KOG0270 WD40 repeat-containing 99.2 3E-10 6.4E-15 126.9 18.5 102 386-502 348-452 (463)
125 KOG4283 Transcription-coupled 99.2 9.1E-10 2E-14 117.9 20.8 135 205-443 123-278 (397)
126 KOG0267 Microtubule severing p 99.2 1.7E-11 3.7E-16 142.6 8.4 214 108-490 41-259 (825)
127 KOG0321 WD40 repeat-containing 99.2 2E-10 4.3E-15 132.5 16.8 121 388-531 238-371 (720)
128 KOG0650 WD40 repeat nucleolar 99.2 9.8E-10 2.1E-14 126.1 21.7 309 86-496 398-732 (733)
129 KOG0299 U3 snoRNP-associated p 99.2 1.2E-09 2.7E-14 122.4 21.9 177 206-501 224-412 (479)
130 KOG4328 WD40 protein [Function 99.2 9.6E-10 2.1E-14 123.2 21.0 99 388-499 299-399 (498)
131 KOG0307 Vesicle coat complex C 99.2 6.3E-11 1.4E-15 143.9 12.6 247 94-501 65-329 (1049)
132 KOG0289 mRNA splicing factor [ 99.2 1.6E-09 3.4E-14 120.8 22.4 239 86-498 259-505 (506)
133 KOG2096 WD40 repeat protein [G 99.2 2.6E-10 5.6E-15 123.0 15.1 107 383-499 202-308 (420)
134 KOG1274 WD40 repeat protein [G 99.2 2.2E-09 4.8E-14 128.2 24.3 236 87-496 55-297 (933)
135 KOG0300 WD40 repeat-containing 99.2 1.3E-09 2.9E-14 117.3 20.3 266 82-501 142-430 (481)
136 KOG0268 Sof1-like rRNA process 99.2 9.2E-11 2E-15 128.2 11.4 214 206-501 89-304 (433)
137 KOG0294 WD40 repeat-containing 99.2 2.2E-09 4.8E-14 115.9 21.2 223 108-443 54-283 (362)
138 KOG0302 Ribosome Assembly prot 99.2 2.3E-10 5E-15 125.6 13.5 118 383-515 227-351 (440)
139 KOG2048 WD40 repeat protein [G 99.2 5.3E-09 1.1E-13 121.8 25.0 248 82-499 66-319 (691)
140 KOG0301 Phospholipase A2-activ 99.2 8.4E-10 1.8E-14 128.4 18.3 207 206-499 35-249 (745)
141 PRK11028 6-phosphogluconolacto 99.1 2.9E-08 6.2E-13 110.1 28.7 103 389-504 196-309 (330)
142 KOG0646 WD40 repeat protein [G 99.1 7.1E-10 1.5E-14 124.5 15.1 111 388-506 101-213 (476)
143 KOG0267 Microtubule severing p 99.1 5.7E-11 1.2E-15 138.3 6.6 116 383-515 85-200 (825)
144 COG2319 FOG: WD40 repeat [Gene 99.1 2.1E-07 4.5E-12 99.1 32.9 254 85-508 62-323 (466)
145 KOG0641 WD40 repeat protein [G 99.1 3.1E-08 6.7E-13 103.0 25.1 100 383-499 197-303 (350)
146 KOG1272 WD40-repeat-containing 99.1 9.7E-11 2.1E-15 131.1 6.7 209 206-498 151-361 (545)
147 KOG0300 WD40 repeat-containing 99.1 1.7E-09 3.7E-14 116.5 15.4 110 383-509 287-397 (481)
148 KOG2048 WD40 repeat protein [G 99.1 1E-08 2.3E-13 119.3 22.7 191 206-515 47-249 (691)
149 PRK11028 6-phosphogluconolacto 99.1 1E-07 2.2E-12 105.8 29.3 112 388-510 146-269 (330)
150 KOG1034 Transcriptional repres 99.1 8.4E-09 1.8E-13 112.0 19.0 254 107-498 106-382 (385)
151 PRK01742 tolB translocation pr 99.0 2.4E-08 5.2E-13 115.5 23.8 79 414-512 336-416 (429)
152 KOG2055 WD40 repeat protein [G 99.0 1.2E-08 2.7E-13 114.6 20.1 98 386-500 321-418 (514)
153 KOG0302 Ribosome Assembly prot 99.0 1.2E-09 2.5E-14 120.2 11.6 106 381-501 271-380 (440)
154 KOG0650 WD40 repeat nucleolar 99.0 3.2E-09 6.9E-14 122.0 15.0 94 389-498 586-679 (733)
155 KOG2106 Uncharacterized conser 99.0 2.1E-07 4.6E-12 105.6 28.6 101 382-498 420-520 (626)
156 KOG4328 WD40 protein [Function 99.0 2.2E-08 4.7E-13 112.6 19.5 109 384-500 339-451 (498)
157 KOG0646 WD40 repeat protein [G 99.0 1.1E-08 2.4E-13 115.2 17.0 121 383-508 191-316 (476)
158 KOG0322 G-protein beta subunit 99.0 5.5E-09 1.2E-13 110.7 13.7 71 411-498 252-322 (323)
159 KOG1009 Chromatin assembly com 99.0 1.8E-09 3.8E-14 119.8 10.3 130 383-515 29-169 (434)
160 KOG1188 WD40 repeat protein [G 99.0 7.8E-09 1.7E-13 112.8 15.0 104 389-506 142-249 (376)
161 KOG0269 WD40 repeat-containing 99.0 9.9E-10 2.1E-14 129.1 8.4 213 383-661 149-370 (839)
162 KOG1587 Cytoplasmic dynein int 98.9 6.1E-08 1.3E-12 114.8 21.2 102 383-500 414-517 (555)
163 KOG1445 Tumor-specific antigen 98.9 5E-09 1.1E-13 120.5 11.3 99 386-501 646-752 (1012)
164 PRK03629 tolB translocation pr 98.9 1.4E-06 3.1E-11 101.0 30.3 103 391-513 312-419 (429)
165 KOG1007 WD repeat protein TSSC 98.9 9E-08 1.9E-12 102.7 17.8 117 383-500 230-362 (370)
166 KOG1332 Vesicle coat complex C 98.9 1.3E-08 2.9E-13 107.0 11.3 114 383-511 26-149 (299)
167 KOG1034 Transcriptional repres 98.8 7.6E-09 1.6E-13 112.4 9.3 100 385-500 110-212 (385)
168 KOG2110 Uncharacterized conser 98.8 1.7E-06 3.6E-11 95.8 25.9 198 208-510 108-343 (391)
169 KOG0321 WD40 repeat-containing 98.8 1.4E-07 3E-12 109.5 18.1 101 388-505 291-397 (720)
170 COG2319 FOG: WD40 repeat [Gene 98.8 1.3E-06 2.9E-11 92.9 24.3 99 388-503 176-275 (466)
171 KOG0644 Uncharacterized conser 98.8 3.3E-08 7.1E-13 117.0 12.7 280 83-500 185-469 (1113)
172 KOG0640 mRNA cleavage stimulat 98.8 7.1E-08 1.5E-12 104.1 13.8 116 383-512 187-305 (430)
173 KOG3881 Uncharacterized conser 98.8 3.2E-07 6.9E-12 101.9 18.9 107 383-505 219-326 (412)
174 KOG1963 WD40 repeat protein [G 98.8 1.4E-06 2.9E-11 104.6 25.5 109 384-510 221-333 (792)
175 KOG1273 WD40 repeat protein [G 98.7 2.5E-08 5.3E-13 107.9 9.0 128 382-510 37-194 (405)
176 KOG1063 RNA polymerase II elon 98.7 4.3E-07 9.3E-12 106.4 19.7 113 390-504 169-302 (764)
177 PRK05137 tolB translocation pr 98.7 6.3E-06 1.4E-10 95.6 29.6 81 391-490 315-397 (435)
178 KOG1063 RNA polymerase II elon 98.7 2.4E-08 5.2E-13 116.5 8.8 99 390-501 552-650 (764)
179 KOG0303 Actin-binding protein 98.7 1.5E-07 3.3E-12 104.4 14.4 118 384-518 148-271 (472)
180 PRK04922 tolB translocation pr 98.7 4.6E-06 1E-10 96.8 27.0 91 391-500 317-410 (433)
181 PF08662 eIF2A: Eukaryotic tra 98.7 1.5E-07 3.3E-12 97.9 13.0 91 387-499 80-179 (194)
182 KOG0303 Actin-binding protein 98.7 1.2E-07 2.6E-12 105.1 12.1 114 383-514 97-218 (472)
183 KOG0270 WD40 repeat-containing 98.7 1.7E-07 3.6E-12 105.3 13.0 118 381-515 257-377 (463)
184 KOG0307 Vesicle coat complex C 98.7 6.7E-08 1.5E-12 118.1 10.5 102 385-501 179-286 (1049)
185 KOG1007 WD repeat protein TSSC 98.7 1.1E-06 2.5E-11 94.4 18.5 100 387-502 190-292 (370)
186 KOG0290 Conserved WD40 repeat- 98.7 1.4E-06 2.9E-11 93.9 18.9 89 390-490 266-357 (364)
187 PRK02889 tolB translocation pr 98.7 1.2E-05 2.5E-10 93.3 28.1 72 413-502 330-404 (427)
188 KOG4378 Nuclear protein COP1 [ 98.6 8.3E-07 1.8E-11 100.7 17.6 107 383-505 94-201 (673)
189 KOG1963 WD40 repeat protein [G 98.6 1E-06 2.2E-11 105.7 18.8 104 388-504 179-286 (792)
190 KOG2111 Uncharacterized conser 98.6 3E-05 6.4E-10 84.8 26.8 108 391-501 205-324 (346)
191 KOG1445 Tumor-specific antigen 98.6 3.7E-07 8E-12 105.6 13.0 91 384-491 694-786 (1012)
192 KOG1517 Guanine nucleotide bin 98.6 1.2E-06 2.6E-11 106.4 17.2 108 382-501 1271-1383(1387)
193 PF10282 Lactonase: Lactonase, 98.6 0.00016 3.5E-09 81.6 33.6 85 412-508 246-331 (345)
194 KOG1009 Chromatin assembly com 98.5 1.7E-05 3.6E-10 88.8 24.1 304 87-501 12-374 (434)
195 KOG0290 Conserved WD40 repeat- 98.5 1.9E-06 4.1E-11 92.9 15.8 107 382-503 211-322 (364)
196 KOG0771 Prolactin regulatory e 98.5 9.3E-07 2E-11 99.0 14.1 75 410-500 281-355 (398)
197 KOG0771 Prolactin regulatory e 98.5 3E-07 6.4E-12 102.9 10.2 131 382-514 158-327 (398)
198 KOG0642 Cell-cycle nuclear pro 98.5 2.2E-07 4.8E-12 106.8 9.4 114 381-501 307-428 (577)
199 KOG2394 WD40 protein DMR-N9 [G 98.5 1.5E-07 3.2E-12 107.6 7.2 95 401-512 281-375 (636)
200 PRK01742 tolB translocation pr 98.5 4.3E-06 9.3E-11 96.9 18.6 90 392-502 274-364 (429)
201 KOG2394 WD40 protein DMR-N9 [G 98.5 1.1E-06 2.4E-11 100.7 12.1 61 382-443 304-364 (636)
202 TIGR02658 TTQ_MADH_Hv methylam 98.4 0.00043 9.3E-09 78.7 31.8 101 390-507 215-338 (352)
203 TIGR02800 propeller_TolB tol-p 98.4 9.4E-05 2E-09 84.4 26.9 85 391-494 303-389 (417)
204 PRK04922 tolB translocation pr 98.4 2.5E-05 5.4E-10 90.7 21.7 94 390-501 272-370 (433)
205 KOG1524 WD40 repeat-containing 98.4 5.2E-06 1.1E-10 95.1 15.1 81 383-494 201-281 (737)
206 KOG1517 Guanine nucleotide bin 98.4 2.9E-05 6.4E-10 94.8 21.7 114 383-510 1224-1343(1387)
207 PF00400 WD40: WD domain, G-be 98.4 8.6E-07 1.9E-11 67.5 5.7 38 401-439 2-39 (39)
208 KOG2445 Nuclear pore complex c 98.3 4.5E-05 9.9E-10 83.0 20.3 118 382-507 27-152 (361)
209 PRK00178 tolB translocation pr 98.3 0.00028 6E-09 81.6 28.6 51 206-256 223-279 (430)
210 PRK03629 tolB translocation pr 98.3 5.3E-05 1.1E-09 88.1 22.6 95 391-501 268-365 (429)
211 PRK05137 tolB translocation pr 98.3 0.00012 2.6E-09 85.0 25.5 92 390-499 270-366 (435)
212 PRK02889 tolB translocation pr 98.3 6.6E-05 1.4E-09 87.2 22.4 95 391-501 265-362 (427)
213 KOG0322 G-protein beta subunit 98.3 9.5E-06 2.1E-10 86.7 13.7 58 382-440 265-322 (323)
214 KOG1538 Uncharacterized conser 98.3 2.3E-06 5.1E-11 99.6 8.9 144 227-497 14-160 (1081)
215 KOG0649 WD40 repeat protein [G 98.3 3.1E-05 6.7E-10 82.1 16.4 109 386-505 132-241 (325)
216 KOG1188 WD40 repeat protein [G 98.2 7.7E-06 1.7E-10 89.9 12.2 105 385-503 89-200 (376)
217 PRK04792 tolB translocation pr 98.2 0.00066 1.4E-08 79.6 28.5 51 206-256 242-298 (448)
218 KOG0644 Uncharacterized conser 98.2 4.1E-07 9E-12 108.0 1.9 96 383-499 205-300 (1113)
219 PF02239 Cytochrom_D1: Cytochr 98.2 0.00035 7.6E-09 80.0 25.6 183 206-507 16-210 (369)
220 KOG1310 WD40 repeat protein [G 98.2 2.2E-06 4.8E-11 98.3 7.4 101 402-518 42-154 (758)
221 PF08662 eIF2A: Eukaryotic tra 98.2 1.4E-05 3E-10 83.3 12.3 95 390-504 37-138 (194)
222 COG2706 3-carboxymuconate cycl 98.2 0.0016 3.6E-08 72.6 28.3 106 389-507 212-329 (346)
223 KOG0642 Cell-cycle nuclear pro 98.2 2.5E-05 5.4E-10 90.4 14.5 57 385-442 506-562 (577)
224 PRK01029 tolB translocation pr 98.1 0.0015 3.2E-08 76.2 28.3 93 392-501 307-405 (428)
225 PF02239 Cytochrom_D1: Cytochr 98.1 2.7E-05 5.9E-10 88.9 13.3 105 387-509 13-118 (369)
226 KOG2139 WD40 repeat protein [G 98.1 0.00016 3.4E-09 80.4 17.8 102 389-508 217-318 (445)
227 KOG1587 Cytoplasmic dynein int 98.1 0.00011 2.5E-09 87.5 17.8 107 382-504 362-477 (555)
228 TIGR02800 propeller_TolB tol-p 98.0 0.00043 9.4E-09 79.0 21.2 93 390-500 258-355 (417)
229 KOG3881 Uncharacterized conser 98.0 0.00035 7.6E-09 78.3 18.0 80 387-484 266-346 (412)
230 PRK00178 tolB translocation pr 97.9 0.0021 4.5E-08 74.4 23.3 93 391-501 268-365 (430)
231 KOG2919 Guanine nucleotide-bin 97.8 0.00023 5E-09 78.1 13.9 111 388-515 177-298 (406)
232 PRK04792 tolB translocation pr 97.8 0.0011 2.4E-08 77.6 20.9 92 391-500 287-381 (448)
233 KOG0974 WD-repeat protein WDR6 97.8 5.1E-05 1.1E-09 92.9 9.8 94 388-499 153-246 (967)
234 PRK04043 tolB translocation pr 97.8 0.021 4.6E-07 66.6 30.3 50 207-256 214-269 (419)
235 KOG4547 WD40 repeat-containing 97.8 0.0005 1.1E-08 80.3 16.2 111 386-515 76-188 (541)
236 PF00400 WD40: WD domain, G-be 97.8 8.6E-05 1.9E-09 56.4 6.7 37 459-497 3-39 (39)
237 KOG2139 WD40 repeat protein [G 97.8 6.8E-05 1.5E-09 83.1 8.4 77 406-499 192-268 (445)
238 KOG4415 Uncharacterized conser 97.7 1.6E-05 3.4E-10 80.8 2.9 32 724-755 28-60 (247)
239 KOG1240 Protein kinase contain 97.7 0.0044 9.6E-08 77.6 23.4 108 388-502 1215-1337(1431)
240 KOG2321 WD40 repeat protein [G 97.7 0.00039 8.5E-09 80.9 13.7 188 207-507 156-351 (703)
241 KOG2321 WD40 repeat protein [G 97.7 0.0027 5.9E-08 74.2 20.3 110 384-509 191-312 (703)
242 KOG1538 Uncharacterized conser 97.7 5.2E-05 1.1E-09 88.8 5.9 89 390-498 33-121 (1081)
243 PRK01029 tolB translocation pr 97.6 0.0036 7.8E-08 73.0 20.8 77 411-501 281-361 (428)
244 KOG3914 WD repeat protein WDR4 97.6 0.00014 3.1E-09 81.6 7.9 103 387-507 129-231 (390)
245 KOG4497 Uncharacterized conser 97.6 0.00074 1.6E-08 74.4 13.1 93 387-497 111-238 (447)
246 COG4946 Uncharacterized protei 97.6 0.014 3.1E-07 67.1 23.2 51 206-256 382-435 (668)
247 PLN02919 haloacid dehalogenase 97.6 0.059 1.3E-06 69.8 31.8 81 414-502 807-891 (1057)
248 KOG4547 WD40 repeat-containing 97.6 0.0069 1.5E-07 71.1 21.0 97 385-500 119-221 (541)
249 KOG0974 WD-repeat protein WDR6 97.5 0.00086 1.9E-08 82.5 14.1 101 385-504 192-293 (967)
250 PF10282 Lactonase: Lactonase, 97.5 0.053 1.2E-06 61.3 27.9 54 389-442 266-323 (345)
251 KOG1240 Protein kinase contain 97.5 0.0016 3.5E-08 81.4 16.2 96 395-501 1034-1130(1431)
252 KOG1354 Serine/threonine prote 97.5 0.0081 1.8E-07 66.8 19.7 80 409-501 271-361 (433)
253 PF13360 PQQ_2: PQQ-like domai 97.5 0.033 7.1E-07 58.2 23.6 91 389-501 131-232 (238)
254 TIGR03300 assembly_YfgL outer 97.5 0.063 1.4E-06 60.9 27.1 103 386-510 247-349 (377)
255 KOG1334 WD40 repeat protein [G 97.4 0.0017 3.6E-08 74.7 13.9 122 83-256 137-267 (559)
256 KOG4227 WD40 repeat protein [G 97.4 0.00096 2.1E-08 74.6 11.4 107 383-504 71-184 (609)
257 KOG1272 WD40-repeat-containing 97.4 0.00015 3.2E-09 82.6 5.1 107 383-508 224-332 (545)
258 KOG0649 WD40 repeat protein [G 97.4 0.00065 1.4E-08 72.3 9.1 80 412-508 116-195 (325)
259 KOG1310 WD40 repeat protein [G 97.4 0.00047 1E-08 79.8 8.4 111 383-500 65-179 (758)
260 KOG1524 WD40 repeat-containing 97.3 0.00032 6.9E-09 81.0 6.2 115 382-498 77-215 (737)
261 COG4946 Uncharacterized protei 97.3 0.004 8.7E-08 71.4 14.7 104 386-508 377-485 (668)
262 KOG1523 Actin-related protein 97.3 0.0036 7.8E-08 69.0 13.2 100 387-500 29-131 (361)
263 KOG2315 Predicted translation 97.2 0.1 2.2E-06 61.5 25.1 100 390-509 251-354 (566)
264 KOG4227 WD40 repeat protein [G 97.2 0.0006 1.3E-08 76.2 6.6 101 403-514 49-149 (609)
265 PF11768 DUF3312: Protein of u 97.2 0.0022 4.7E-08 75.6 11.3 91 392-501 238-331 (545)
266 smart00320 WD40 WD40 repeats. 97.2 0.001 2.2E-08 46.8 5.6 39 400-439 2-40 (40)
267 KOG1064 RAVE (regulator of V-A 97.2 0.0011 2.5E-08 85.1 9.3 91 388-507 2313-2406(2439)
268 TIGR03300 assembly_YfgL outer 97.1 0.2 4.2E-06 57.0 26.4 92 386-497 285-377 (377)
269 COG2706 3-carboxymuconate cycl 97.1 0.005 1.1E-07 68.8 13.0 114 413-546 147-262 (346)
270 KOG1912 WD40 repeat protein [G 97.1 0.0044 9.6E-08 74.5 13.1 102 384-501 441-553 (1062)
271 KOG1523 Actin-related protein 97.1 0.0067 1.4E-07 67.0 13.3 97 389-498 76-175 (361)
272 KOG1409 Uncharacterized conser 97.1 0.012 2.7E-07 65.4 15.2 99 387-501 172-272 (404)
273 KOG4497 Uncharacterized conser 97.1 0.0029 6.2E-08 69.9 10.2 86 388-491 69-155 (447)
274 TIGR02658 TTQ_MADH_Hv methylam 97.0 0.0077 1.7E-07 68.6 13.7 102 390-507 27-144 (352)
275 PF04762 IKI3: IKI3 family; I 97.0 0.71 1.5E-05 59.2 31.6 98 389-501 236-335 (928)
276 PF13360 PQQ_2: PQQ-like domai 96.9 0.48 1E-05 49.5 25.1 57 206-262 3-64 (238)
277 KOG1275 PAB-dependent poly(A) 96.9 0.012 2.7E-07 71.9 14.2 182 206-498 157-341 (1118)
278 KOG2315 Predicted translation 96.9 0.021 4.5E-07 66.9 15.4 51 389-441 335-390 (566)
279 PF07433 DUF1513: Protein of u 96.8 0.69 1.5E-05 51.9 25.9 96 391-501 139-249 (305)
280 PRK04043 tolB translocation pr 96.6 0.29 6.3E-06 57.2 22.2 81 390-490 257-339 (419)
281 KOG0280 Uncharacterized conser 96.5 0.012 2.6E-07 64.5 9.8 102 388-504 141-246 (339)
282 KOG1275 PAB-dependent poly(A) 96.3 0.041 8.8E-07 67.7 13.5 100 108-257 149-259 (1118)
283 PF08450 SGL: SMP-30/Gluconola 96.2 1.9 4.2E-05 45.9 24.3 99 390-499 115-213 (246)
284 KOG1645 RING-finger-containing 96.1 0.013 2.8E-07 66.4 7.3 96 392-505 175-272 (463)
285 PF15492 Nbas_N: Neuroblastoma 96.1 0.76 1.7E-05 50.6 20.3 99 409-507 146-267 (282)
286 COG5354 Uncharacterized protei 96.0 0.79 1.7E-05 53.8 20.8 123 87-251 31-159 (561)
287 KOG4532 WD40-like repeat conta 95.9 0.62 1.3E-05 51.0 18.3 61 382-443 217-284 (344)
288 KOG2314 Translation initiation 95.6 0.052 1.1E-06 63.7 9.5 93 391-501 232-336 (698)
289 COG3386 Gluconolactonase [Carb 95.5 1.4 2.9E-05 49.8 20.4 100 390-499 143-243 (307)
290 PF08450 SGL: SMP-30/Gluconola 95.3 0.8 1.7E-05 48.8 17.3 95 389-501 21-123 (246)
291 PF04762 IKI3: IKI3 family; I 95.3 8 0.00017 49.9 28.7 75 408-498 302-378 (928)
292 KOG1064 RAVE (regulator of V-A 95.3 0.091 2E-06 68.7 11.0 121 383-508 2223-2375(2439)
293 PF03178 CPSF_A: CPSF A subuni 95.2 0.97 2.1E-05 50.4 18.1 94 390-500 107-203 (321)
294 KOG4190 Uncharacterized conser 95.2 0.053 1.1E-06 63.3 7.9 124 382-508 749-915 (1034)
295 KOG4532 WD40-like repeat conta 95.2 0.23 5E-06 54.2 12.1 99 388-502 138-236 (344)
296 smart00320 WD40 WD40 repeats. 95.1 0.037 8E-07 38.5 4.2 28 470-497 13-40 (40)
297 KOG4190 Uncharacterized conser 95.0 0.02 4.3E-07 66.6 4.0 85 402-498 727-811 (1034)
298 PF03178 CPSF_A: CPSF A subuni 94.9 7.9 0.00017 43.2 28.3 50 206-255 62-118 (321)
299 KOG1912 WD40 repeat protein [G 94.9 1.5 3.2E-05 53.9 19.0 117 108-262 27-153 (1062)
300 KOG2314 Translation initiation 94.8 0.063 1.4E-06 63.0 7.1 95 412-532 212-317 (698)
301 KOG4640 Anaphase-promoting com 94.6 0.12 2.5E-06 61.8 9.0 77 412-506 22-99 (665)
302 KOG2066 Vacuolar assembly/sort 94.6 0.12 2.6E-06 63.1 9.2 94 384-504 53-151 (846)
303 COG0823 TolB Periplasmic compo 94.4 0.62 1.3E-05 54.7 14.4 51 206-256 218-274 (425)
304 KOG2695 WD40 repeat protein [G 94.4 0.11 2.3E-06 58.3 7.4 105 385-502 269-379 (425)
305 PRK11138 outer membrane biogen 94.3 5.7 0.00012 45.7 21.8 57 206-262 130-188 (394)
306 PF15492 Nbas_N: Neuroblastoma 94.0 0.28 6E-06 53.9 9.6 72 416-500 3-74 (282)
307 COG5354 Uncharacterized protei 93.8 0.11 2.3E-06 60.7 6.2 93 395-507 17-124 (561)
308 KOG0309 Conserved WD40 repeat- 93.6 0.37 8E-06 58.5 10.4 104 384-504 131-237 (1081)
309 KOG3914 WD repeat protein WDR4 93.6 0.96 2.1E-05 51.7 13.1 59 383-443 166-225 (390)
310 PF12894 Apc4_WD40: Anaphase-p 93.2 0.22 4.8E-06 40.6 5.5 30 469-498 11-40 (47)
311 PRK11138 outer membrane biogen 93.1 9.7 0.00021 43.8 21.0 89 389-498 303-393 (394)
312 KOG2695 WD40 repeat protein [G 93.1 0.18 3.9E-06 56.6 6.4 113 388-515 232-348 (425)
313 PLN02919 haloacid dehalogenase 93.1 0.9 1.9E-05 59.2 13.7 115 385-501 700-835 (1057)
314 KOG3621 WD40 repeat-containing 92.8 0.26 5.5E-06 59.7 7.6 101 387-500 52-155 (726)
315 KOG1354 Serine/threonine prote 92.8 0.23 5.1E-06 55.7 6.7 81 411-505 26-122 (433)
316 KOG2041 WD40 repeat protein [G 92.6 0.2 4.4E-06 60.3 6.3 98 384-496 30-142 (1189)
317 PF00780 CNH: CNH domain; Int 92.3 4.1 8.9E-05 44.0 15.7 43 220-262 223-265 (275)
318 KOG0280 Uncharacterized conser 91.9 0.5 1.1E-05 52.2 7.7 104 384-504 182-289 (339)
319 PRK02888 nitrous-oxide reducta 91.8 1.6 3.5E-05 53.3 12.6 114 386-503 211-355 (635)
320 KOG4640 Anaphase-promoting com 91.7 0.5 1.1E-05 56.7 8.0 58 384-443 36-94 (665)
321 cd00216 PQQ_DH Dehydrogenases 91.5 17 0.00037 43.4 20.9 57 206-262 71-138 (488)
322 PF07433 DUF1513: Protein of u 91.4 29 0.00063 39.2 26.7 71 409-501 215-285 (305)
323 KOG4714 Nucleoporin [Nuclear s 91.1 0.14 3E-06 55.7 2.4 57 385-442 197-255 (319)
324 KOG1334 WD40 repeat protein [G 91.0 0.34 7.3E-06 56.5 5.5 97 402-514 134-235 (559)
325 COG5170 CDC55 Serine/threonine 90.9 0.48 1E-05 52.6 6.4 103 383-500 237-368 (460)
326 PF04841 Vps16_N: Vps16, N-ter 90.8 39 0.00085 39.6 23.0 48 205-253 60-110 (410)
327 PF11768 DUF3312: Protein of u 90.2 0.91 2E-05 54.2 8.3 58 383-443 274-331 (545)
328 KOG0882 Cyclophilin-related pe 90.1 0.86 1.9E-05 52.9 7.7 115 388-506 120-238 (558)
329 KOG4714 Nucleoporin [Nuclear s 89.3 0.43 9.2E-06 52.0 4.3 95 390-500 159-255 (319)
330 PF00930 DPPIV_N: Dipeptidyl p 89.1 1.2 2.5E-05 50.7 8.0 103 389-501 22-133 (353)
331 KOG1832 HIV-1 Vpr-binding prot 88.9 0.21 4.6E-06 61.4 1.9 106 382-506 1115-1221(1516)
332 PF12894 Apc4_WD40: Anaphase-p 88.7 1.1 2.4E-05 36.6 5.4 31 410-441 11-41 (47)
333 PF06433 Me-amine-dh_H: Methyl 88.1 1.1 2.3E-05 51.1 6.6 57 206-262 269-330 (342)
334 PF04053 Coatomer_WDAD: Coatom 88.0 22 0.00049 42.2 17.8 58 422-500 117-174 (443)
335 KOG3617 WD40 and TPR repeat-co 87.8 0.62 1.3E-05 57.3 4.8 98 387-503 38-135 (1416)
336 PF14783 BBS2_Mid: Ciliary BBS 87.4 5 0.00011 38.8 9.8 65 413-498 2-70 (111)
337 KOG2041 WD40 repeat protein [G 87.0 3.7 7.9E-05 50.2 10.4 241 385-666 88-345 (1189)
338 KOG1920 IkappaB kinase complex 86.7 70 0.0015 41.9 21.6 98 390-501 222-324 (1265)
339 KOG0309 Conserved WD40 repeat- 86.7 1.6 3.5E-05 53.3 7.3 108 392-515 93-205 (1081)
340 KOG2079 Vacuolar assembly/sort 86.4 1.4 3E-05 55.8 6.9 56 387-443 106-162 (1206)
341 PRK13616 lipoprotein LpqB; Pro 86.3 4.6 0.0001 49.5 11.2 92 390-499 379-476 (591)
342 COG0823 TolB Periplasmic compo 86.1 2.3 5E-05 50.0 8.3 96 390-505 218-318 (425)
343 PF08553 VID27: VID27 cytoplas 85.8 9.1 0.0002 48.4 13.5 58 382-441 590-647 (794)
344 PF00780 CNH: CNH domain; Int 85.4 22 0.00047 38.3 15.0 53 204-256 112-169 (275)
345 COG3386 Gluconolactonase [Carb 84.9 29 0.00063 39.2 15.9 121 390-544 47-179 (307)
346 cd00216 PQQ_DH Dehydrogenases 84.7 97 0.0021 37.1 23.2 58 206-263 120-194 (488)
347 KOG2066 Vacuolar assembly/sort 84.6 6.2 0.00013 48.9 10.9 106 382-507 85-195 (846)
348 KOG0882 Cyclophilin-related pe 83.6 8.7 0.00019 45.0 11.0 97 403-502 194-308 (558)
349 TIGR03075 PQQ_enz_alc_DH PQQ-d 83.4 1E+02 0.0022 37.5 20.7 53 389-443 440-492 (527)
350 PF10168 Nup88: Nuclear pore c 83.0 20 0.00044 45.0 14.9 91 411-504 85-184 (717)
351 PF10313 DUF2415: Uncharacteri 82.9 2.7 5.9E-05 33.9 4.8 32 411-443 1-35 (43)
352 PF06433 Me-amine-dh_H: Methyl 82.9 36 0.00078 39.1 15.5 51 391-443 270-322 (342)
353 COG3391 Uncharacterized conser 82.8 18 0.00038 41.9 13.5 95 388-500 94-191 (381)
354 PF00930 DPPIV_N: Dipeptidyl p 82.2 70 0.0015 36.4 17.9 50 206-255 23-74 (353)
355 KOG1409 Uncharacterized conser 82.1 7.8 0.00017 44.0 9.7 113 399-515 103-244 (404)
356 KOG2079 Vacuolar assembly/sort 82.0 1.8 3.8E-05 55.0 5.2 74 421-511 98-172 (1206)
357 PF05694 SBP56: 56kDa selenium 81.2 13 0.00027 43.9 11.3 109 387-505 219-348 (461)
358 TIGR03075 PQQ_enz_alc_DH PQQ-d 81.0 1.4E+02 0.003 36.3 23.8 59 206-264 130-201 (527)
359 PF02897 Peptidase_S9_N: Proly 80.3 9.9 0.00021 43.8 10.3 76 412-504 125-215 (414)
360 COG5170 CDC55 Serine/threonine 79.6 3.2 6.9E-05 46.4 5.6 86 411-501 27-119 (460)
361 PRK13616 lipoprotein LpqB; Pro 79.3 11 0.00024 46.3 10.7 103 389-505 429-531 (591)
362 KOG2395 Protein involved in va 78.8 71 0.0015 38.6 16.3 58 382-441 443-500 (644)
363 PRK02888 nitrous-oxide reducta 78.7 14 0.0003 45.4 11.1 106 389-500 295-405 (635)
364 PF08553 VID27: VID27 cytoplas 78.5 9.5 0.00021 48.2 9.9 91 390-499 552-647 (794)
365 KOG1645 RING-finger-containing 77.8 6.6 0.00014 45.4 7.5 50 206-255 216-269 (463)
366 KOG2114 Vacuolar assembly/sort 77.4 9.9 0.00021 47.6 9.3 105 386-497 41-153 (933)
367 PF10313 DUF2415: Uncharacteri 77.4 6.4 0.00014 31.8 5.2 29 472-500 3-34 (43)
368 PF14655 RAB3GAP2_N: Rab3 GTPa 76.6 16 0.00034 43.1 10.5 90 403-508 300-407 (415)
369 PF14781 BBS2_N: Ciliary BBSom 75.2 16 0.00035 36.5 8.6 46 215-260 37-89 (136)
370 PF02897 Peptidase_S9_N: Proly 74.9 20 0.00043 41.4 10.8 99 387-500 147-261 (414)
371 COG3391 Uncharacterized conser 73.4 49 0.0011 38.2 13.5 93 389-500 139-240 (381)
372 PF08596 Lgl_C: Lethal giant l 72.7 25 0.00055 41.1 10.9 83 402-500 78-174 (395)
373 PF08728 CRT10: CRT10; InterP 72.6 1.2E+02 0.0025 38.4 16.8 74 411-498 164-245 (717)
374 KOG1832 HIV-1 Vpr-binding prot 72.0 4.7 0.0001 50.4 4.8 90 401-507 1092-1184(1516)
375 KOG2377 Uncharacterized conser 70.4 90 0.0019 37.2 14.2 91 410-515 66-157 (657)
376 PF14783 BBS2_Mid: Ciliary BBS 70.1 96 0.0021 30.1 12.2 88 383-494 18-109 (111)
377 PF07676 PD40: WD40-like Beta 70.0 13 0.00028 28.2 5.3 31 408-438 6-38 (39)
378 KOG3617 WD40 and TPR repeat-co 70.0 8.4 0.00018 48.1 6.2 56 385-441 76-131 (1416)
379 PF12234 Rav1p_C: RAVE protein 69.5 46 0.001 41.3 12.5 101 390-499 51-156 (631)
380 KOG2444 WD40 repeat protein [G 67.8 12 0.00025 40.6 6.1 104 385-505 75-183 (238)
381 KOG1897 Damage-specific DNA bi 67.6 3.8E+02 0.0083 35.0 21.9 95 390-499 848-942 (1096)
382 PF07676 PD40: WD40-like Beta 65.8 12 0.00027 28.4 4.4 26 471-496 10-38 (39)
383 KOG1920 IkappaB kinase complex 61.0 34 0.00074 44.6 9.3 67 411-495 69-135 (1265)
384 PF10647 Gmad1: Lipoprotein Lp 60.7 71 0.0015 34.9 10.8 75 412-500 67-145 (253)
385 smart00036 CNH Domain found in 60.6 1.4E+02 0.0031 33.4 13.5 43 220-262 238-280 (302)
386 KOG4460 Nuclear pore complex, 58.5 1.2E+02 0.0026 36.7 12.5 87 411-503 104-202 (741)
387 PF14583 Pectate_lyase22: Olig 57.0 93 0.002 36.4 11.3 99 388-500 262-382 (386)
388 PF14870 PSII_BNR: Photosynthe 55.7 73 0.0016 36.1 10.0 70 410-497 144-213 (302)
389 PF14781 BBS2_N: Ciliary BBSom 54.2 1.8E+02 0.004 29.3 11.3 56 206-261 73-134 (136)
390 PF04053 Coatomer_WDAD: Coatom 54.1 30 0.00064 41.2 7.0 46 206-252 126-173 (443)
391 PF12234 Rav1p_C: RAVE protein 53.6 1.1E+02 0.0023 38.2 11.7 79 405-499 24-104 (631)
392 KOG2395 Protein involved in va 52.3 38 0.00083 40.8 7.2 27 471-498 473-499 (644)
393 KOG3621 WD40 repeat-containing 51.8 25 0.00054 43.4 5.8 76 410-501 33-108 (726)
394 TIGR02276 beta_rpt_yvtn 40-res 51.7 82 0.0018 23.7 6.9 24 420-443 1-24 (42)
395 COG3490 Uncharacterized protei 51.6 1.8E+02 0.0039 32.9 11.8 54 208-262 51-109 (366)
396 KOG4649 PQQ (pyrrolo-quinoline 51.1 85 0.0018 35.0 9.1 86 386-488 69-155 (354)
397 KOG4649 PQQ (pyrrolo-quinoline 49.9 4.2E+02 0.0091 29.8 17.0 56 206-261 73-132 (354)
398 PF12657 TFIIIC_delta: Transcr 49.8 1.2E+02 0.0025 31.1 9.8 30 471-500 87-122 (173)
399 COG5422 ROM1 RhoGEF, Guanine n 48.2 1.5E+02 0.0033 37.9 11.6 35 229-263 1102-1136(1175)
400 PF07569 Hira: TUP1-like enhan 45.6 1.2E+02 0.0026 32.6 9.3 75 418-500 18-96 (219)
401 PF05787 DUF839: Bacterial pro 44.7 43 0.00093 40.7 6.5 70 415-487 440-519 (524)
402 PF06977 SdiA-regulated: SdiA- 44.3 2.4E+02 0.0052 31.0 11.6 82 405-503 16-98 (248)
403 PF10214 Rrn6: RNA polymerase 44.2 6.8E+02 0.015 32.0 17.2 74 411-502 204-279 (765)
404 PF01731 Arylesterase: Arylest 43.7 1E+02 0.0022 28.5 7.3 50 390-442 36-85 (86)
405 KOG2114 Vacuolar assembly/sort 42.5 1.8E+02 0.0039 37.2 11.1 95 390-499 92-201 (933)
406 PF11715 Nup160: Nucleoporin N 41.3 1E+02 0.0022 37.2 9.0 36 472-507 217-256 (547)
407 PRK10115 protease 2; Provision 40.6 1.1E+02 0.0025 38.3 9.5 73 411-501 127-209 (686)
408 PF05096 Glu_cyclase_2: Glutam 39.8 1.4E+02 0.0031 33.2 8.9 57 206-262 110-167 (264)
409 PF07569 Hira: TUP1-like enhan 39.6 52 0.0011 35.3 5.5 38 220-257 7-45 (219)
410 PF10214 Rrn6: RNA polymerase 39.2 1.4E+02 0.0029 38.2 9.9 84 411-503 146-236 (765)
411 PF10647 Gmad1: Lipoprotein Lp 38.3 1.6E+02 0.0034 32.1 9.1 67 412-497 25-93 (253)
412 PF14870 PSII_BNR: Photosynthe 37.7 2E+02 0.0043 32.7 9.9 89 389-490 164-253 (302)
413 PF07250 Glyoxal_oxid_N: Glyox 37.5 88 0.0019 34.4 6.9 89 391-490 47-138 (243)
414 KOG1897 Damage-specific DNA bi 37.4 1.1E+03 0.024 31.1 27.7 72 404-488 709-794 (1096)
415 KOG1916 Nuclear protein, conta 37.1 12 0.00025 47.3 0.1 98 388-503 151-269 (1283)
416 COG3490 Uncharacterized protei 36.9 1.7E+02 0.0037 33.2 8.8 75 392-488 93-180 (366)
417 PF01011 PQQ: PQQ enzyme repea 36.5 64 0.0014 24.6 4.1 27 237-263 3-29 (38)
418 PF06977 SdiA-regulated: SdiA- 36.4 4.6E+02 0.01 28.9 12.2 106 385-500 39-148 (248)
419 smart00036 CNH Domain found in 36.4 3.5E+02 0.0075 30.4 11.6 38 108-147 14-52 (302)
420 TIGR03606 non_repeat_PQQ dehyd 35.9 1.1E+02 0.0023 36.8 7.7 20 413-432 148-167 (454)
421 PF04841 Vps16_N: Vps16, N-ter 35.5 2.2E+02 0.0047 33.5 10.2 29 470-499 81-109 (410)
422 KOG1008 Uncharacterized conser 35.4 13 0.00028 45.3 0.2 107 388-513 127-240 (783)
423 KOG1008 Uncharacterized conser 35.3 13 0.00027 45.5 0.0 102 387-500 77-185 (783)
424 KOG1916 Nuclear protein, conta 34.8 27 0.00058 44.3 2.6 106 387-504 202-328 (1283)
425 PF03022 MRJP: Major royal jel 32.3 7.4E+02 0.016 27.6 13.3 54 390-443 34-98 (287)
426 PF05096 Glu_cyclase_2: Glutam 30.3 8.2E+02 0.018 27.4 20.8 56 206-261 68-127 (264)
427 smart00564 PQQ beta-propeller 29.3 1.2E+02 0.0025 21.8 4.4 25 236-260 8-32 (33)
428 COG3211 PhoX Predicted phospha 27.8 1.3E+02 0.0029 36.7 6.7 65 413-487 502-571 (616)
429 TIGR03074 PQQ_membr_DH membran 27.2 1.4E+03 0.031 29.3 22.6 56 206-261 204-287 (764)
430 PF13570 PQQ_3: PQQ-like domai 26.9 1.4E+02 0.003 22.8 4.6 22 232-253 18-40 (40)
431 PF14761 HPS3_N: Hermansky-Pud 26.4 2E+02 0.0044 31.1 7.1 58 416-490 23-80 (215)
432 PF13449 Phytase-like: Esteras 26.2 8.3E+02 0.018 27.6 12.6 85 410-501 146-251 (326)
433 PF01731 Arylesterase: Arylest 25.8 1E+02 0.0022 28.6 4.2 29 472-500 56-85 (86)
434 COG2133 Glucose/sorbosone dehy 25.2 2.2E+02 0.0048 33.6 7.8 20 412-431 178-197 (399)
435 PF05694 SBP56: 56kDa selenium 24.6 1.3E+02 0.0028 35.9 5.7 47 205-251 221-276 (461)
436 PRK10115 protease 2; Provision 24.3 6.2E+02 0.014 31.9 12.1 99 387-500 150-256 (686)
437 KOG0183 20S proteasome, regula 24.0 47 0.001 35.6 1.9 19 611-629 7-27 (249)
438 PF12768 Rax2: Cortical protei 23.8 8E+02 0.017 27.5 11.6 55 389-443 15-74 (281)
439 PF07995 GSDH: Glucose / Sorbo 23.7 4.1E+02 0.0089 30.1 9.5 80 401-494 244-330 (331)
440 PF12341 DUF3639: Protein of u 23.6 1.5E+02 0.0032 21.8 3.7 24 472-497 4-27 (27)
441 TIGR02604 Piru_Ver_Nterm putat 23.4 2E+02 0.0044 32.9 7.1 64 410-488 123-202 (367)
442 PF03088 Str_synth: Strictosid 22.9 1.9E+02 0.004 27.0 5.4 46 385-431 32-77 (89)
443 PF14269 Arylsulfotran_2: Aryl 22.4 2.8E+02 0.006 31.3 7.7 71 413-499 146-220 (299)
444 TIGR02608 delta_60_rpt delta-6 22.2 1.9E+02 0.0042 24.6 4.9 32 472-503 3-39 (55)
445 PF03022 MRJP: Major royal jel 21.8 1.1E+03 0.025 26.2 18.5 57 205-261 33-105 (287)
446 PF08596 Lgl_C: Lethal giant l 21.4 6.2E+02 0.013 29.8 10.6 90 412-509 3-123 (395)
447 TIGR02604 Piru_Ver_Nterm putat 21.3 4.5E+02 0.0098 30.1 9.4 61 412-485 15-86 (367)
448 PF11715 Nup160: Nucleoporin N 20.9 1.7E+02 0.0037 35.3 6.1 31 412-443 216-250 (547)
No 1
>PF12490 BCAS3: Breast carcinoma amplified sequence 3 ; InterPro: IPR022175 This domain family is found in eukaryotes, and is typically between 229 and 245 amino acids in length. The proteins in this family have been shown to be proto-oncogenes implicated in the development of breast cancer.
Probab=100.00 E-value=1.5e-60 Score=509.54 Aligned_cols=241 Identities=47% Similarity=0.725 Sum_probs=213.5
Q ss_pred CCceeeeeeeEEecCC-CCCCccccchhhhccC-CccCCCcceeeeeeccCCCccccccCCcccccccEEEEccCCcEEE
Q 002446 546 GPPVTLSVVSRIRNGN-NGWRGTVSGAAAAATG-RVSSLSGAIASSFHNCKGNSETYAAGSSLKIKNHLLVFSPSGCMIQ 623 (921)
Q Consensus 546 ~~pv~ls~v~rI~~~~-~~w~~~v~~~~~~~~~-~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~L~v~sp~G~liq 623 (921)
|||++|++|+|||+++ +||.++|++++++|+| |.+.++||+|+.||+|.+....+..+...+++||||||+|+|+|||
T Consensus 1 P~Pv~l~~vsrIK~~~~~g~~~tv~~aassa~g~~~~~~sga~a~~f~~~~~~~~~~~~~~~~~~~~~LlV~spsG~Liq 80 (251)
T PF12490_consen 1 PPPVTLSVVSRIKQGNTLGWLNTVSNAASSATGGKPSSVSGAFASSFHNSKGSSSEPSDSSSSKAVESLLVFSPSGHLIQ 80 (251)
T ss_pred CCCEEechHHhhcCCccccccccccccccchhcCCcccceeEEccccccCCCCcccccccccccccceEEEECCCCcEEE
Confidence 5799999999999999 8999999999999999 8899999999999999777656667776889999999999999999
Q ss_pred EeeecccCCCcccCCCCCCCCCCCC-CCCCceEEEeeeeeeecccccccccccc-cccccCCCCCcCC-CcccccccccC
Q 002446 624 YALRISTGLDVTMGVPGLGSAYDSV-PEDDPRLVVEAIQKWNICQKQARRERED-NIDIYGDNGTLDS-NKIYPEEVKDG 700 (921)
Q Consensus 624 y~L~p~~~~~~~~~~~~~~~~~~~~-~~~~~~~~vep~~~Wdvcrr~~~~e~e~-~~~~~~~~~~~~~-~~~~~~~~~~~ 700 (921)
|+|+|+.++|++++.++.+++++++ +|++|||+|||+||||||||++|+||++ +..++++++..+. ++|+++..+++
T Consensus 81 y~L~p~~~~~~~~~~~~~~~~~~~~~~~~~l~l~vep~~~Wdl~R~~~w~e~~~d~~~~~~~~~~~~~~~~~~~~~~~~~ 160 (251)
T PF12490_consen 81 YELRPSPGSDPTEGGSGNGPPSESQMDDTELRLVVEPVQQWDLCRRPNWPEREEDCVPPLPENNPLDSASKIDPSDCRKG 160 (251)
T ss_pred EEEeeccccCcccccccccCccccccccCcceEEeeeccceeEeccccCCccchhccCCCCCCCHhhhhhhccccccccc
Confidence 9999999999999999999999999 7799999999999999999999999999 6667777765444 46777777776
Q ss_pred C-cccCCCccccccCCCCcccccceeeeeeEEeecCC-CcccccCCeeEEEEeecCcc-ccccccccc--ceEEEeeccc
Q 002446 701 N-FASTEANGVIEKTKVSPEDKHHLYISEAELQMHPP-RIPLWAKPQIYFQSMMIKDF-KMGEENFLK--GEIEIERFPT 775 (921)
Q Consensus 701 ~-~~~~~~~~~~~~~~~~~~E~~~~ylSnaEvq~h~~-~~plW~~~qi~F~~m~~~~~-~~~~~~~~~--~e~eie~~~~ 775 (921)
+ +++.+...+ .+.+++++|+++|||||||||||++ ||||||||||+||+|.+++. ++...+..+ ||||||++|+
T Consensus 161 ~~~~~~~~~~~-~~~~~~~~e~~~~wlS~vEi~th~~phrpLW~gpQf~F~~~~~~~~~~~~~s~~~~~~~e~EIE~~~~ 239 (251)
T PF12490_consen 161 NSVNPSNDSYV-SKESDSPEERDHWWLSNVEIQTHSGPHRPLWMGPQFSFKTMSSPSSSELNISSSSGEAGEIEIEKIPT 239 (251)
T ss_pred CCccccccccc-cccCCCcccccCcEEeeeeeEeccCCccccccCCcEEEEEecCCCCccccccccccccCceeeccccc
Confidence 5 666654444 6678888999999999999999999 69999999999999998774 444555667 9999999999
Q ss_pred cccccccCCccc
Q 002446 776 RMIEARSKDLVP 787 (921)
Q Consensus 776 ~~~~~~~~~l~p 787 (921)
|+||+|+|||||
T Consensus 240 ~~ve~r~k~l~p 251 (251)
T PF12490_consen 240 REVEIRRKDLLP 251 (251)
T ss_pred cceeeeccccCC
Confidence 999999999998
No 2
>KOG2109 consensus WD40 repeat protein [General function prediction only]
Probab=100.00 E-value=1.6e-59 Score=530.81 Aligned_cols=641 Identities=28% Similarity=0.300 Sum_probs=459.9
Q ss_pred CCchhHHhcceeeeccCcchhhhhhhhhccccccCCCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCC
Q 002446 48 KSPFRAISSYFRIVSSGASTVARSAVSVASSIVERDDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEAD 127 (921)
Q Consensus 48 ~~s~~~~s~~~~~~ss~~~t~~~~~a~~~~s~~~~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~ 127 (921)
|+||++||+|+|.+|||++++++++++..++-+ +.++|||+|++||+ ..+..+.||+++|.+||||||+++..
T Consensus 2 p~s~~~vs~c~k~~ssg~~~~~~s~~~~~ss~~----~e~~dqvlw~~fD~---~~~~~~~Vlll~~~~gfqv~d~~Dsp 74 (788)
T KOG2109|consen 2 PPSANSVSGCKKKNSSGHQRPQQSHQQTQSSPL----PEEEDQVLWIKFDP---KPEVLEEVLLLNREEGFQVVDETDSP 74 (788)
T ss_pred CcccchhccchhhcccccccHHHHHHhhcCCCC----hhhhccccccccCC---chhHHHHHHHHhhccCceEEeeccCC
Confidence 899999999999999999999988766655544 56899999999997 55557899999999999999999999
Q ss_pred CeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCC-CCCCCc
Q 002446 128 NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGN-GSSVPT 206 (921)
Q Consensus 128 ~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~-~~~~~~ 206 (921)
.+++.++.+++++.|.+|++.|+.++. .+.|+.++|++|+|.. +...-.+.++ ++|. ....+.
T Consensus 75 ~vh~~vs~~dd~~~f~sm~~~pl~sg~-~~gf~ss~avpavv~~-t~S~p~I~~S--------------~~Gse~d~t~a 138 (788)
T KOG2109|consen 75 TVHKEVSISDDLLDFSSMDKSPLSSGP-DSGFESSDAVPAVVRT-TTSPPTIPPS--------------QTGSEQDSTQA 138 (788)
T ss_pred ccceeeeecCCcceecccCCCCccCCC-CCccccCCceeeeccc-ccCCCcCCCC--------------CCcceeccccc
Confidence 999999999999999999999998854 5669999999999982 1111111111 0111 112345
Q ss_pred EEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC
Q 002446 207 VVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP 286 (921)
Q Consensus 207 tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp 286 (921)
-..++||++..++|.|+|+ +|+|||+.|++..+.+.+++.+.. +.+++|+|+++++
T Consensus 139 n~~v~dl~S~~yah~l~fR-------------------qi~CfDa~tle~d~~~~~n~~p~l-----~l~VGYGplaVg~ 194 (788)
T KOG2109|consen 139 NEMVVDLMSLDYAHALPFR-------------------QIHCFDAPTLEIDSMNTINTKPRL-----LLSVGYGPLAVGR 194 (788)
T ss_pred ccceeccccccchhccccc-------------------ccccccCcccCCchhhcccccccc-----ceeecccccccee
Confidence 5778999999999999996 899999999998888887765533 2468899999999
Q ss_pred ceEEecCCCceecCCCccCCccccccccccc--ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcC
Q 002446 287 RWLAYSGSPVVVSNDGRVNPQHLMQSRSFSG--FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQN 364 (921)
Q Consensus 287 RwLAyas~~~~~s~~GrvsPq~l~~s~~~~~--~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~ 364 (921)
||+||+...+..... +..++-.+.++ +...+..++.||++.+|++|.||..+||.+|+.+++||....+.+.+
T Consensus 195 rWaaya~~~a~~vss-----~~Vt~~~~VspttSs~~~~~va~~A~essk~lA~gl~nlgDkGy~~isglc~g~~~~g~g 269 (788)
T KOG2109|consen 195 RWAAYAQTLANQVSS-----HLVTMGMSVSPTTSSQITAEVAEWAQESSKELAGGLVNLGDKGYVLISGLCRGSYQIGTG 269 (788)
T ss_pred eeeeeccCcchhhhh-----ccccccccccCCCCCchhHHHHHhhhhhhHHHhhhhcccccchHHHHHHHhhcccCCCCC
Confidence 999999765433211 11111122222 34456678999999999999999999999999999999988776644
Q ss_pred CcccccCCCCCCCcccCcccccCC-CCE--EEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 365 SLQSAIPGGKSNGTVNGHFPDADN-VGM--VIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 365 si~sa~~~~k~~g~v~g~~~s~~~-~G~--V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
.-.......+ .|.+..+ ++.. .|+ +.+-|+.+.+.+.+|++|+++|++|||+++|.+|++++..|+.|++|.++
T Consensus 270 pglgg~~~~~-vGrvg~v--saesV~g~~~vivkdf~S~a~i~QfkAhkspiSaLcfdqsgsllViasi~g~nVnvfRim 346 (788)
T KOG2109|consen 270 PGLGGFEEVL-VGRVGPV--SAESVLGNNLVIVKDFDSFADIRQFKAHKSPISALCFDQSGSLLVIASITGRNVNVFRIM 346 (788)
T ss_pred CCCCCcCcee-ccccccc--cceeecccceEEeecccchhhhhheeeecCcccccccccCceEEEEEeeccceeeeEEec
Confidence 3221111111 1111111 2222 355 88899999999999999999999999999999999999999999999998
Q ss_pred CCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcccccCCc
Q 002446 442 PGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFTTKHGAM 521 (921)
Q Consensus 442 ~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~~~~~~~ 521 (921)
+....... +.. -+.--+||++.+.|++|+|+-+.+|++.+|.+|+- +.+ .
T Consensus 347 et~~t~~~-~~q-----s~~~s~ra~t~aviqdicfs~~s~~r~~gsc~Ge~-----------P~l-------------s 396 (788)
T KOG2109|consen 347 ETVCTVNV-SDQ-----SLVVSPRANTAAVIQDICFSEVSTIRTAGSCEGEP-----------PAL-------------S 396 (788)
T ss_pred cccccccc-ccc-----ccccchhcchHHHHHHHhhhhhcceEeecccCCCC-----------ccc-------------c
Confidence 75221100 100 00111589999999999999999999999966643 111 1
Q ss_pred CCccccCCCCCCCCCCCCcccccCCCceeeeeeeEEecCCCCCCccccchhhhccCCccCCCcceeeeeeccCCCccccc
Q 002446 522 AKSGVRWPPNLGLQMPNQQSLCASGPPVTLSVVSRIRNGNNGWRGTVSGAAAAATGRVSSLSGAIASSFHNCKGNSETYA 601 (921)
Q Consensus 522 ~~~~~r~~~~s~l~~~~~~~l~~~~~pv~ls~v~rI~~~~~~w~~~v~~~~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~ 601 (921)
.+.-.+|+..+.+.. ...-..++...+|...+++.-.+.- +|+.-.++.-.+++.-+..||-...-.
T Consensus 397 ~t~~lp~~A~~Sl~~--gl~s~g~~aa~gla~~sag~~a~s~-------~asSv~s~s~~pd~ks~gv~~gsv~k~---- 463 (788)
T KOG2109|consen 397 LTCQLPAYADTSLDL--GLQSSGGLAAEGLATSSAGYTAHSY-------TASSVFSRSVKPDSKSVGVGSGSVTKA---- 463 (788)
T ss_pred cccccchhhchhhhc--cccccCcccceeeeecccccccccc-------ccceeeccccccchhhccceeeecccc----
Confidence 111123332222211 1111122335556666666654311 222223444445555555555431110
Q ss_pred cCCcccccccEEEEccCC-cEEEEeeecccCCCcccC-CCCCCCCCCCCCCCC-ceEEEeeeeeeecccccccccccccc
Q 002446 602 AGSSLKIKNHLLVFSPSG-CMIQYALRISTGLDVTMG-VPGLGSAYDSVPEDD-PRLVVEAIQKWNICQKQARREREDNI 678 (921)
Q Consensus 602 ~~~~~~~~~~L~v~sp~G-~liqy~L~p~~~~~~~~~-~~~~~~~~~~~~~~~-~~~~vep~~~Wdvcrr~~~~e~e~~~ 678 (921)
.......++.|+|+.|+| +|+||.|.++.+..-.+. ...++.-.+...|+| .++.|+|++.|+.||+.+|+|++++
T Consensus 464 ~q~~~~~l~~llv~~psGd~vvqh~vahs~~gv~~Ef~~~~~l~lSad~~e~ef~~f~V~Ph~~wsslaav~hly~l~r- 542 (788)
T KOG2109|consen 464 NQGVITVLNLLLVGEPSGDGVVQHYVAHSDPGVYIEFSPDQRLVLSADANENEFNIFLVMPHATWSSLAAVQHLYKLNR- 542 (788)
T ss_pred CccchhhhhheeeecCCCCceeEEEeeccCccceeeecccccceecccccccccceEEeecccccHHHhhhhhhhhccC-
Confidence 112345799999999999 999999999998887764 556666677778888 9999999999999999999999996
Q ss_pred cccCCCCCcCCCcccccccccCCcccCCCccccccCCCCcccccceeeeeeEEeecCCCcccccCCeeEEEEeecCcccc
Q 002446 679 DIYGDNGTLDSNKIYPEEVKDGNFASTEANGVIEKTKVSPEDKHHLYISEAELQMHPPRIPLWAKPQIYFQSMMIKDFKM 758 (921)
Q Consensus 679 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~E~~~~ylSnaEvq~h~~~~plW~~~qi~F~~m~~~~~~~ 758 (921)
.++ +-|.+...++++..-.... .+...+.-+++|.|+-++|++||.. +|||+|.+ .||.|...+.+.
T Consensus 543 --G~T-----saKv~~~afs~dsrw~A~~----t~~~TthVfk~hpYgg~aeqrth~~-lp~vnk~s-rFhrsagl~~d~ 609 (788)
T KOG2109|consen 543 --GST-----SAKVVSTAFSEDSRWLAIT----TNHATTHVFKVHPYGGKAEQRTHGD-LPFVNKES-RFHRSAGLTDDA 609 (788)
T ss_pred --CCc-----cceeeeeEeecchhhhhhh----hcCCceeeeeeccccccccceecCC-chhccchh-hhccccCCCccc
Confidence 222 1255666666543111111 2344456789999999999999999 99999999 999999877655
Q ss_pred ccccc--ccceEEEeeccccccccccCCcccccccccCccccccc
Q 002446 759 GEENF--LKGEIEIERFPTRMIEARSKDLVPVFDYLQSPKFSQAR 801 (921)
Q Consensus 759 ~~~~~--~~~e~eie~~~~~~~~~~~~~l~pv~~~~~~~~~~~~~ 801 (921)
+.++. .++|.||+++.++.+|.|+||||||++ .+|+|-+-.|
T Consensus 610 ~~~~s~ggg~e~ei~~~~~~t~e~r~~dllPvy~-~tS~rsr~~~ 653 (788)
T KOG2109|consen 610 DVTASIGGGKEREIADSCSYTKEHRIADLLPVYA-KTSGRSRVGP 653 (788)
T ss_pred cccccCCCCccceecccccccccccccccCCccc-ccCccccccC
Confidence 54443 455999999999999999999999999 6666654333
No 3
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=100.00 E-value=1.9e-34 Score=311.26 Aligned_cols=243 Identities=27% Similarity=0.499 Sum_probs=212.5
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
+.++.+.+.+|+| +. .+|.+|..+|+++|.+++.+ +..+...+.+..++||. +..|
T Consensus 3 ~~~~ti~~~~~Nq---d~----~~lsvGs~~Gyk~~~~~~~~---k~~~~~~~~~~IvEmLF--------------SSSL 58 (391)
T KOG2110|consen 3 GKKPTINFIGFNQ---DS----TLLSVGSKDGYKIFSCSPFE---KCFSKDTEGVSIVEMLF--------------SSSL 58 (391)
T ss_pred CCCcceeeeeecc---ce----eEEEccCCCceeEEecCchH---HhhcccCCCeEEEEeec--------------ccce
Confidence 4577899999999 66 89999999999999999854 35677778999999995 3579
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEEEeCCE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAICQAAQ 245 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAVa~d~~ 245 (921)
||+|+.. .|+.+++++++.+..++.+.|+++|.+|++|++.|+|++++.
T Consensus 59 vaiV~~~-------------------------------qpr~Lkv~~~Kk~~~ICe~~fpt~IL~VrmNr~RLvV~Lee~ 107 (391)
T KOG2110|consen 59 VAIVSIK-------------------------------QPRKLKVVHFKKKTTICEIFFPTSILAVRMNRKRLVVCLEES 107 (391)
T ss_pred eEEEecC-------------------------------CCceEEEEEcccCceEEEEecCCceEEEEEccceEEEEEccc
Confidence 9999852 237899999999999999999999999999999999999999
Q ss_pred EEEEECCCCcEEEEEecC-CCccCCCCCCCCCccccceeecC----ceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 246 VHCFDAATLEIEYAILTN-PIVMGHPSAGGIGIGYGPLAVGP----RWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 246 I~IwDl~T~~~l~tL~t~-p~~~g~p~~~g~~i~~~piAlgp----RwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
|+|||+.+|+.+++|++. |++.+. +|+++ .+|||+++
T Consensus 108 IyIydI~~MklLhTI~t~~~n~~gl------------~AlS~n~~n~ylAyp~s-------------------------- 149 (391)
T KOG2110|consen 108 IYIYDIKDMKLLHTIETTPPNPKGL------------CALSPNNANCYLAYPGS-------------------------- 149 (391)
T ss_pred EEEEecccceeehhhhccCCCccce------------EeeccCCCCceEEecCC--------------------------
Confidence 999999999999999987 444332 34433 35665410
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
...|.|.|||+.+.
T Consensus 150 ------------------------------------------------------------------~t~GdV~l~d~~nl 163 (391)
T KOG2110|consen 150 ------------------------------------------------------------------TTSGDVVLFDTINL 163 (391)
T ss_pred ------------------------------------------------------------------CCCceEEEEEcccc
Confidence 12478999999999
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
+++..+.+|.+++.||+|||||++|||||++||+||||.+..+ ..+|+||||...+.|++|+||||
T Consensus 164 ~~v~~I~aH~~~lAalafs~~G~llATASeKGTVIRVf~v~~G--------------~kl~eFRRG~~~~~IySL~Fs~d 229 (391)
T KOG2110|consen 164 QPVNTINAHKGPLAALAFSPDGTLLATASEKGTVIRVFSVPEG--------------QKLYEFRRGTYPVSIYSLSFSPD 229 (391)
T ss_pred eeeeEEEecCCceeEEEECCCCCEEEEeccCceEEEEEEcCCc--------------cEeeeeeCCceeeEEEEEEECCC
Confidence 9999999999999999999999999999999999999999876 78999999999888999999999
Q ss_pred CCEEEEEeCCCcEEEEecCCC
Q 002446 481 SNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~ 501 (921)
+++|+++|.-+|||||.+...
T Consensus 230 s~~L~~sS~TeTVHiFKL~~~ 250 (391)
T KOG2110|consen 230 SQFLAASSNTETVHIFKLEKV 250 (391)
T ss_pred CCeEEEecCCCeEEEEEeccc
Confidence 999999999999999999875
No 4
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=100.00 E-value=3e-32 Score=290.01 Aligned_cols=250 Identities=25% Similarity=0.395 Sum_probs=208.6
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeee--eecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVS--RYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS--~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
.+.+.+-++|+| |. .|+++|.++||+||++++ ++|..+ .+++++..++||.+ .+
T Consensus 4 ~~~~~lsvs~NQ---D~----ScFava~~~Gfriyn~~P---~ke~~~r~~~~~G~~~veMLfR--------------~N 59 (346)
T KOG2111|consen 4 EEPKTLSVSFNQ---DH----SCFAVATDTGFRIYNCDP---FKESASRQFIDGGFKIVEMLFR--------------SN 59 (346)
T ss_pred ccCceeEEEEcc---CC----ceEEEEecCceEEEecCc---hhhhhhhccccCchhhhhHhhh--------------hc
Confidence 345677799999 76 799999999999999999 455444 34667999999964 48
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEEEeCC
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAICQAA 244 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAVa~d~ 244 (921)
+||+|+++. ++.|.|++|.|||.....++.+|.|.++|.+|++.+..|+|.+++
T Consensus 60 ~laLVGGg~--------------------------~pky~pNkviIWDD~k~~~i~el~f~~~I~~V~l~r~riVvvl~~ 113 (346)
T KOG2111|consen 60 YLALVGGGS--------------------------RPKYPPNKVIIWDDLKERCIIELSFNSEIKAVKLRRDRIVVVLEN 113 (346)
T ss_pred eEEEecCCC--------------------------CCCCCCceEEEEecccCcEEEEEEeccceeeEEEcCCeEEEEecC
Confidence 999999643 256788999999999999999999999999999999999999999
Q ss_pred EEEEEECC-CCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCc
Q 002446 245 QVHCFDAA-TLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGS 323 (921)
Q Consensus 245 ~I~IwDl~-T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~ 323 (921)
+|++|... +.+.++.+++.++|.|.+ ++.| . .
T Consensus 114 ~I~VytF~~n~k~l~~~et~~NPkGlC------------~~~~--------------------~-~-------------- 146 (346)
T KOG2111|consen 114 KIYVYTFPDNPKLLHVIETRSNPKGLC------------SLCP--------------------T-S-------------- 146 (346)
T ss_pred eEEEEEcCCChhheeeeecccCCCceE------------eecC--------------------C-C--------------
Confidence 99999998 788999999987766542 2110 0 0
Q ss_pred ceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCce-
Q 002446 324 RVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNV- 402 (921)
Q Consensus 324 ~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~- 402 (921)
.|. ..++|+. ..|.|+|-|+...+.
T Consensus 147 ---------~k~-------------------------------~LafPg~--------------k~GqvQi~dL~~~~~~ 172 (346)
T KOG2111|consen 147 ---------NKS-------------------------------LLAFPGF--------------KTGQVQIVDLASTKPN 172 (346)
T ss_pred ---------Cce-------------------------------EEEcCCC--------------ccceEEEEEhhhcCcC
Confidence 000 0233432 237899999876654
Q ss_pred -EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCC
Q 002446 403 -IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDS 481 (921)
Q Consensus 403 -l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg 481 (921)
...+.||.++|.||+.+-+|++|||||.+||.|||||..++ ..++++|||...|.|++|+||||+
T Consensus 173 ~p~~I~AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g--------------~~l~E~RRG~d~A~iy~iaFSp~~ 238 (346)
T KOG2111|consen 173 APSIINAHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDG--------------TLLQELRRGVDRADIYCIAFSPNS 238 (346)
T ss_pred CceEEEcccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCC--------------cEeeeeecCCchheEEEEEeCCCc
Confidence 47889999999999999999999999999999999999987 678999999999999999999999
Q ss_pred CEEEEEeCCCcEEEEecCCC
Q 002446 482 NWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWdi~~~ 501 (921)
.|||++|+.||+|||.+...
T Consensus 239 s~LavsSdKgTlHiF~l~~~ 258 (346)
T KOG2111|consen 239 SWLAVSSDKGTLHIFSLRDT 258 (346)
T ss_pred cEEEEEcCCCeEEEEEeecC
Confidence 99999999999999999764
No 5
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.92 E-value=2.8e-24 Score=232.93 Aligned_cols=292 Identities=16% Similarity=0.264 Sum_probs=219.8
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+|+..|+.+.+.+ || +.|+.|..+| +.+||-...+..-.-+.+|...|.++.+.|-...+ ..|
T Consensus 155 gH~~WVlcvawsP---Dg----k~iASG~~dg~I~lwdpktg~~~g~~l~gH~K~It~Lawep~hl~p--------~~r- 218 (480)
T KOG0271|consen 155 GHKNWVLCVAWSP---DG----KKIASGSKDGSIRLWDPKTGQQIGRALRGHKKWITALAWEPLHLVP--------PCR- 218 (480)
T ss_pred CCccEEEEEEECC---Cc----chhhccccCCeEEEecCCCCCcccccccCcccceeEEeecccccCC--------Ccc-
Confidence 7899999999999 88 6788888555 99999988766777788999999999998754332 122
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC-CEEEE-E
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS-RVVAI-C 241 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~-riLAV-a 241 (921)
+||.++. ++.|+|||+..++++..+.. ..+|..|++-+ .+|.. +
T Consensus 219 ~las~sk---------------------------------Dg~vrIWd~~~~~~~~~lsgHT~~VTCvrwGG~gliySgS 265 (480)
T KOG0271|consen 219 RLASSSK---------------------------------DGSVRIWDTKLGTCVRTLSGHTASVTCVRWGGEGLIYSGS 265 (480)
T ss_pred ceecccC---------------------------------CCCEEEEEccCceEEEEeccCccceEEEEEcCCceEEecC
Confidence 4443331 26799999999999999875 56999999974 56666 7
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCce----EEecCCCceecCCCccCCccccccccccc
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRW----LAYSGSPVVVSNDGRVNPQHLMQSRSFSG 317 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRw----LAyas~~~~~s~~GrvsPq~l~~s~~~~~ 317 (921)
.|++|++|++..+.+.+.+.+|. ..+|.+|++..| =||- ++|+..++
T Consensus 266 ~DrtIkvw~a~dG~~~r~lkGHa------------hwvN~lalsTdy~LRtgaf~-------~t~~~~~~---------- 316 (480)
T KOG0271|consen 266 QDRTIKVWRALDGKLCRELKGHA------------HWVNHLALSTDYVLRTGAFD-------HTGRKPKS---------- 316 (480)
T ss_pred CCceEEEEEccchhHHHhhcccc------------hheeeeeccchhhhhccccc-------cccccCCC----------
Confidence 89999999999999999998873 345667765422 2222 12221000
Q ss_pred ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEEC
Q 002446 318 FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDI 397 (921)
Q Consensus 318 ~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl 397 (921)
..|...+.+.+|-. ..+++ | -.++++..++++.+|+-
T Consensus 317 -------------------------~se~~~~Al~rY~~-~~~~~--------------~---erlVSgsDd~tlflW~p 353 (480)
T KOG0271|consen 317 -------------------------FSEEQKKALERYEA-VLKDS--------------G---ERLVSGSDDFTLFLWNP 353 (480)
T ss_pred -------------------------hHHHHHHHHHHHHH-hhccC--------------c---ceeEEecCCceEEEecc
Confidence 00111123344421 11111 0 12456788899999996
Q ss_pred C-CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 398 V-SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 398 ~-s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
. +.+++..+.+|..-|..+.|||||+++|+||.|.. ||+||-.+| +.+..| |||-. .|+.|+
T Consensus 354 ~~~kkpi~rmtgHq~lVn~V~fSPd~r~IASaSFDkS-VkLW~g~tG--------------k~lasf-RGHv~-~VYqva 416 (480)
T KOG0271|consen 354 FKSKKPITRMTGHQALVNHVSFSPDGRYIASASFDKS-VKLWDGRTG--------------KFLASF-RGHVA-AVYQVA 416 (480)
T ss_pred cccccchhhhhchhhheeeEEECCCccEEEEeecccc-eeeeeCCCc--------------chhhhh-hhccc-eeEEEE
Confidence 5 56688999999999999999999999999999965 999999987 445565 78754 499999
Q ss_pred EccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 477 FSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
||.|++.|+++|.|.|++||++.+.+-...+-+|.+++-
T Consensus 417 wsaDsRLlVS~SkDsTLKvw~V~tkKl~~DLpGh~DEVf 455 (480)
T KOG0271|consen 417 WSADSRLLVSGSKDSTLKVWDVRTKKLKQDLPGHADEVF 455 (480)
T ss_pred eccCccEEEEcCCCceEEEEEeeeeeecccCCCCCceEE
Confidence 999999999999999999999999888888999998887
No 6
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.88 E-value=1.6e-21 Score=227.11 Aligned_cols=239 Identities=21% Similarity=0.371 Sum_probs=176.4
Q ss_pred EEEEEEecccCCCCCCCeEEEEEccC-cEEEEEccCC--------CCe----------------------EEeeeeecCC
Q 002446 91 VLWAGFDKLESEAGATRRVLLLGYRS-GFQVWDVEEA--------DNV----------------------HDLVSRYDGP 139 (921)
Q Consensus 91 V~w~~Fd~~~~d~~~~~~vLllG~~~-GfqVWDv~~~--------~~~----------------------~elvS~~dG~ 139 (921)
+.++.|.. |+ ++|+.|..+ .++||.+.+. ..+ .+.+-+|.||
T Consensus 381 v~ca~fSd---ds----smlA~Gf~dS~i~~~Sl~p~kl~~lk~~~~l~~~d~~sad~~~~~~D~~~~~~~~~L~GH~GP 453 (707)
T KOG0263|consen 381 VTCAEFSD---DS----SMLACGFVDSSVRVWSLTPKKLKKLKDASDLSNIDTESADVDVDMLDDDSSGTSRTLYGHSGP 453 (707)
T ss_pred ceeEeecC---Cc----chhhccccccEEEEEecchhhhccccchhhhccccccccchhhhhccccCCceeEEeecCCCc
Confidence 55555554 44 689999855 5899999851 111 1223357788
Q ss_pred EEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEE
Q 002446 140 VSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYV 219 (921)
Q Consensus 140 Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V 219 (921)
|.-+.+.|. +.+|.-|+. | ++||+|+|.|..++
T Consensus 454 Vyg~sFsPd--------------~rfLlScSE----------D-----------------------~svRLWsl~t~s~~ 486 (707)
T KOG0263|consen 454 VYGCSFSPD--------------RRFLLSCSE----------D-----------------------SSVRLWSLDTWSCL 486 (707)
T ss_pred eeeeeeccc--------------ccceeeccC----------C-----------------------cceeeeecccceeE
Confidence 888777763 345554442 2 78999999999999
Q ss_pred EEEeC-CCCEEEEEEcC--CEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCC
Q 002446 220 HMLKF-RSPIYSVRCSS--RVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSP 295 (921)
Q Consensus 220 ~tL~f-~s~V~sV~~S~--riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~ 295 (921)
-..+. ..||+.|+|++ -++|. +.|.+-++|.....+.++.+.+|-.- ++.+ +|.
T Consensus 487 V~y~GH~~PVwdV~F~P~GyYFatas~D~tArLWs~d~~~PlRifaghlsD------------V~cv-------~FH--- 544 (707)
T KOG0263|consen 487 VIYKGHLAPVWDVQFAPRGYYFATASHDQTARLWSTDHNKPLRIFAGHLSD------------VDCV-------SFH--- 544 (707)
T ss_pred EEecCCCcceeeEEecCCceEEEecCCCceeeeeecccCCchhhhcccccc------------cceE-------EEC---
Confidence 88875 46999999985 46666 67889999998776666555544211 1111 121
Q ss_pred ceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCC
Q 002446 296 VVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKS 375 (921)
Q Consensus 296 ~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~ 375 (921)
+-+.|
T Consensus 545 ------------------------------------------------------PNs~Y--------------------- 549 (707)
T KOG0263|consen 545 ------------------------------------------------------PNSNY--------------------- 549 (707)
T ss_pred ------------------------------------------------------Ccccc---------------------
Confidence 11122
Q ss_pred CCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 376 NGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 376 ~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
.+++..|.+|++||+.+|..+..|.+|+++|++|+|||+|++||+|+.||. |+|||+..+
T Consensus 550 -------~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~LaSg~ed~~-I~iWDl~~~------------ 609 (707)
T KOG0263|consen 550 -------VATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYLASGDEDGL-IKIWDLANG------------ 609 (707)
T ss_pred -------cccCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceEeecccCCc-EEEEEcCCC------------
Confidence 123456789999999999999999999999999999999999999999996 999999976
Q ss_pred ceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 456 SYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
..+..+ +|| ...|++|.||.||..||+++.|.+|++||+....+.
T Consensus 610 --~~v~~l-~~H-t~ti~SlsFS~dg~vLasgg~DnsV~lWD~~~~~~~ 654 (707)
T KOG0263|consen 610 --SLVKQL-KGH-TGTIYSLSFSRDGNVLASGGADNSVRLWDLTKVIEL 654 (707)
T ss_pred --cchhhh-hcc-cCceeEEEEecCCCEEEecCCCCeEEEEEchhhccc
Confidence 233344 677 456999999999999999999999999999865444
No 7
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.88 E-value=1.6e-21 Score=214.04 Aligned_cols=256 Identities=15% Similarity=0.229 Sum_probs=201.3
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+..-.|..+.|-. ++ ..|+.|.-.| .+||.++.. +...++..|.+.|.++.+-|.- +--
T Consensus 173 gd~rPis~~~fS~---ds----~~laT~swsG~~kvW~~~~~-~~~~~l~gH~~~v~~~~fhP~~------------~~~ 232 (459)
T KOG0272|consen 173 GDTRPISGCSFSR---DS----KHLATGSWSGLVKVWSVPQC-NLLQTLRGHTSRVGAAVFHPVD------------SDL 232 (459)
T ss_pred cCCCcceeeEeec---CC----CeEEEeecCCceeEeecCCc-ceeEEEeccccceeeEEEccCC------------Ccc
Confidence 3456699999988 77 5777777666 699999985 6666788899999999998731 111
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCEEEE-
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRVVAI- 240 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~riLAV- 240 (921)
-||.|. .+++|++|++.+...+..|.. ...|..|+|. +++|+.
T Consensus 233 ~lat~s---------------------------------~Dgtvklw~~~~e~~l~~l~gH~~RVs~VafHPsG~~L~Ta 279 (459)
T KOG0272|consen 233 NLATAS---------------------------------ADGTVKLWKLSQETPLQDLEGHLARVSRVAFHPSGKFLGTA 279 (459)
T ss_pred ceeeec---------------------------------cCCceeeeccCCCcchhhhhcchhhheeeeecCCCceeeec
Confidence 233332 227899999999999999875 5799999994 789988
Q ss_pred EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 241 CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 241 a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
+.|.+=++||+.|.+.+...++|... + . -|||- |
T Consensus 280 sfD~tWRlWD~~tk~ElL~QEGHs~~------------v--~-----~iaf~-------------~-------------- 313 (459)
T KOG0272|consen 280 SFDSTWRLWDLETKSELLLQEGHSKG------------V--F-----SIAFQ-------------P-------------- 313 (459)
T ss_pred ccccchhhcccccchhhHhhcccccc------------c--c-----eeEec-------------C--------------
Confidence 89999999999999888777777431 1 1 12332 1
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
.|+++ ++++.|..-+|||+.++
T Consensus 314 DGSL~----------------------------------------------------------~tGGlD~~~RvWDlRtg 335 (459)
T KOG0272|consen 314 DGSLA----------------------------------------------------------ATGGLDSLGRVWDLRTG 335 (459)
T ss_pred CCcee----------------------------------------------------------eccCccchhheeecccC
Confidence 12211 22345667799999999
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc-
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD- 479 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP- 479 (921)
+++-.|.+|..+|..|+|||+|..|||||.|++ +||||+... ..+|.+. +|+ .-|..|.|+|
T Consensus 336 r~im~L~gH~k~I~~V~fsPNGy~lATgs~Dnt-~kVWDLR~r--------------~~ly~ip-AH~-nlVS~Vk~~p~ 398 (459)
T KOG0272|consen 336 RCIMFLAGHIKEILSVAFSPNGYHLATGSSDNT-CKVWDLRMR--------------SELYTIP-AHS-NLVSQVKYSPQ 398 (459)
T ss_pred cEEEEecccccceeeEeECCCceEEeecCCCCc-EEEeeeccc--------------ccceecc-ccc-chhhheEeccc
Confidence 999999999999999999999999999999987 899999874 3466653 443 3499999999
Q ss_pred CCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 480 DSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
.|++|+++|-|+|++||.-........+.+|.+.+.
T Consensus 399 ~g~fL~TasyD~t~kiWs~~~~~~~ksLaGHe~kV~ 434 (459)
T KOG0272|consen 399 EGYFLVTASYDNTVKIWSTRTWSPLKSLAGHEGKVI 434 (459)
T ss_pred CCeEEEEcccCcceeeecCCCcccchhhcCCccceE
Confidence 899999999999999999999988899999987765
No 8
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.87 E-value=3.5e-21 Score=209.10 Aligned_cols=256 Identities=14% Similarity=0.190 Sum_probs=193.7
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
..+|.+.|+.+.|.. ++ +.|+.|. +..+++||+++ .-...++.+|...|.|+.+.|+.
T Consensus 111 ~~GH~e~Vl~~~fsp---~g----~~l~tGsGD~TvR~WD~~T-eTp~~t~KgH~~WVlcvawsPDg------------- 169 (480)
T KOG0271|consen 111 IAGHGEAVLSVQFSP---TG----SRLVTGSGDTTVRLWDLDT-ETPLFTCKGHKNWVLCVAWSPDG------------- 169 (480)
T ss_pred cCCCCCcEEEEEecC---CC----ceEEecCCCceEEeeccCC-CCcceeecCCccEEEEEEECCCc-------------
Confidence 458999999999998 66 5666666 66799999998 34556788999999999999851
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEE-EEEe-CCCCEEEEEEc------
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYV-HMLK-FRSPIYSVRCS------ 234 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V-~tL~-f~s~V~sV~~S------ 234 (921)
..|| ++ . ..++|++||-++|+++ ..|. ++-.|.++++-
T Consensus 170 -k~iA--SG-~------------------------------~dg~I~lwdpktg~~~g~~l~gH~K~It~Lawep~hl~p 215 (480)
T KOG0271|consen 170 -KKIA--SG-S------------------------------KDGSIRLWDPKTGQQIGRALRGHKKWITALAWEPLHLVP 215 (480)
T ss_pred -chhh--cc-c------------------------------cCCeEEEecCCCCCcccccccCcccceeEEeecccccCC
Confidence 1122 11 0 2278999999999765 4555 46689999994
Q ss_pred -CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccc
Q 002446 235 -SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQS 312 (921)
Q Consensus 235 -~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s 312 (921)
.|+||. +-|+.|+|||+.-+++++++.+|.++..| +. ..
T Consensus 216 ~~r~las~skDg~vrIWd~~~~~~~~~lsgHT~~VTC------------vr-------wG-------------------- 256 (480)
T KOG0271|consen 216 PCRRLASSSKDGSVRIWDTKLGTCVRTLSGHTASVTC------------VR-------WG-------------------- 256 (480)
T ss_pred CccceecccCCCCEEEEEccCceEEEEeccCccceEE------------EE-------Ec--------------------
Confidence 267777 66899999999999999998877432111 10 00
Q ss_pred cccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEE
Q 002446 313 RSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMV 392 (921)
Q Consensus 313 ~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V 392 (921)
|+ | .+.++..|++|
T Consensus 257 ---------G~---------------g------------------------------------------liySgS~DrtI 270 (480)
T KOG0271|consen 257 ---------GE---------------G------------------------------------------LIYSGSQDRTI 270 (480)
T ss_pred ---------CC---------------c------------------------------------------eEEecCCCceE
Confidence 00 0 11234668999
Q ss_pred EEEECCCCceEEEeccCCCCeEEEEEC-----------CCCCE-------------------------EEEEecCCCEEE
Q 002446 393 IVRDIVSKNVIAQFRAHKSPISALCFD-----------PSGIL-------------------------LVTASVQGHNIN 436 (921)
Q Consensus 393 ~IwDl~s~~~l~~~~aH~~pIsaLaFS-----------PdGtl-------------------------LATaS~DGt~Ir 436 (921)
++|+...|.++..|++|.+.|+.|+.| |.|.. |++||+|.+ +-
T Consensus 271 kvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~~erlVSgsDd~t-lf 349 (480)
T KOG0271|consen 271 KVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDSGERLVSGSDDFT-LF 349 (480)
T ss_pred EEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccCcceeEEecCCce-EE
Confidence 999999999999999999999999866 54555 999999998 78
Q ss_pred EEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 437 IFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 437 IWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
+|+-... .+.+.++ .| +.+.|..++||||++|+|++|.|..|++|+-.+++-..+|++|-..+.
T Consensus 350 lW~p~~~-------------kkpi~rm-tg-Hq~lVn~V~fSPd~r~IASaSFDkSVkLW~g~tGk~lasfRGHv~~VY 413 (480)
T KOG0271|consen 350 LWNPFKS-------------KKPITRM-TG-HQALVNHVSFSPDGRYIASASFDKSVKLWDGRTGKFLASFRGHVAAVY 413 (480)
T ss_pred Eeccccc-------------ccchhhh-hc-hhhheeeEEECCCccEEEEeecccceeeeeCCCcchhhhhhhccceeE
Confidence 9986542 1222222 24 345699999999999999999999999999999988899999955544
No 9
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.87 E-value=2.3e-20 Score=194.13 Aligned_cols=275 Identities=19% Similarity=0.282 Sum_probs=190.3
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
.+...||+..+|.|...+ |.+...+...|+.|..+++.|+ +.+||+++.
T Consensus 12 iLvsA~YDhTIRfWqa~t-G~C~rTiqh~dsqVNrLeiTpd--------------k~~LAaa~~---------------- 60 (311)
T KOG0315|consen 12 ILVSAGYDHTIRFWQALT-GICSRTIQHPDSQVNRLEITPD--------------KKDLAAAGN---------------- 60 (311)
T ss_pred EEEeccCcceeeeeehhc-CeEEEEEecCccceeeEEEcCC--------------cchhhhccC----------------
Confidence 445568999999999998 7888888888999999999874 234543331
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCc--EEEEEeCC-CCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEe
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQS--YVHMLKFR-SPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAIL 261 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~--~V~tL~f~-s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~ 261 (921)
-.||+||+.+++ .+.++... ..|.+|.|- +|.+.. +.|++++|||++...+.+.+.
T Consensus 61 ------------------qhvRlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~~ 122 (311)
T KOG0315|consen 61 ------------------QHVRLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNYQ 122 (311)
T ss_pred ------------------CeeEEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecCCCceEEEEeccCcccchhcc
Confidence 359999999986 57777765 688888884 788887 778999999999977654443
Q ss_pred cCCCccCCCCCCCCCccccceeecC--ceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcce
Q 002446 262 TNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAG 339 (921)
Q Consensus 262 t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasG 339 (921)
++. .++.+.+.| --|-..+. +|
T Consensus 123 -~~s------------pVn~vvlhpnQteLis~dq-------------------------------------------sg 146 (311)
T KOG0315|consen 123 -HNS------------PVNTVVLHPNQTELISGDQ-------------------------------------------SG 146 (311)
T ss_pred -CCC------------CcceEEecCCcceEEeecC-------------------------------------------CC
Confidence 211 122333322 01111100 12
Q ss_pred eEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC------ceEEEeccCCCCe
Q 002446 340 IVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK------NVIAQFRAHKSPI 413 (921)
Q Consensus 340 l~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~------~~l~~~~aH~~pI 413 (921)
-+.++|.+-+..+ ..+.|+...++++..=.+. | ..++.+.+.|...+|++-+. .++..|++|++-|
T Consensus 147 ~irvWDl~~~~c~---~~liPe~~~~i~sl~v~~d--g---sml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~i 218 (311)
T KOG0315|consen 147 NIRVWDLGENSCT---HELIPEDDTSIQSLTVMPD--G---SMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHI 218 (311)
T ss_pred cEEEEEccCCccc---cccCCCCCcceeeEEEcCC--C---cEEEEecCCccEEEEEccCCCccccceEhhheecccceE
Confidence 2233333322221 1245665544443211110 1 12345567799999998764 4778899999999
Q ss_pred EEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcE
Q 002446 414 SALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTS 493 (921)
Q Consensus 414 saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTV 493 (921)
..+.||||+++|||||.|.+ ++||++... ...-..+ .|+. .-+++++||.||+||+++|.|+++
T Consensus 219 l~C~lSPd~k~lat~ssdkt-v~iwn~~~~-------------~kle~~l-~gh~-rWvWdc~FS~dg~YlvTassd~~~ 282 (311)
T KOG0315|consen 219 LRCLLSPDVKYLATCSSDKT-VKIWNTDDF-------------FKLELVL-TGHQ-RWVWDCAFSADGEYLVTASSDHTA 282 (311)
T ss_pred EEEEECCCCcEEEeecCCce-EEEEecCCc-------------eeeEEEe-ecCC-ceEEeeeeccCccEEEecCCCCce
Confidence 99999999999999999987 899998863 1111223 2432 249999999999999999999999
Q ss_pred EEEecCCCCCceeecCCC
Q 002446 494 HLFAINPLGGSVNFQPTD 511 (921)
Q Consensus 494 hVWdi~~~g~~~~l~~H~ 511 (921)
|+|++...++..-.++|.
T Consensus 283 rlW~~~~~k~v~qy~gh~ 300 (311)
T KOG0315|consen 283 RLWDLSAGKEVRQYQGHH 300 (311)
T ss_pred eecccccCceeeecCCcc
Confidence 999999988878888884
No 10
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.87 E-value=7.1e-20 Score=205.24 Aligned_cols=405 Identities=13% Similarity=0.199 Sum_probs=251.3
Q ss_pred hcccccCCCC--CCCCCccee-cCCCCchhHHhcceeeeccCc--chhh-hhh-hhhcccccc---------CCCCCCCC
Q 002446 26 FSGMRNSTDG--PKPQNGVVS-RSTKSPFRAISSYFRIVSSGA--STVA-RSA-VSVASSIVE---------RDDESSHD 89 (921)
Q Consensus 26 ~~~~~~~~~~--~~~~~g~~~-~~~~~s~~~~s~~~~~~ss~~--~t~~-~~~-a~~~~s~~~---------~~~~~~kd 89 (921)
++|||--|-| |.+ .|-++ -.+=+|.--|+|-=|.|-|-. .|-+ |.+ .|==++|+= .....|..
T Consensus 113 ~ds~RI~avGEGrer-fg~~F~~DSG~SvGei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~Hsk 191 (603)
T KOG0318|consen 113 FDSKRIAAVGEGRER-FGHVFLWDSGNSVGEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHSK 191 (603)
T ss_pred CCCcEEEEEecCccc-eeEEEEecCCCccceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeeccccccc
Confidence 6889965554 444 55433 236677777777766665542 1111 000 111111111 12335666
Q ss_pred cEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeee--eecCCEEEEEEecCCCCCccccCccccCCCEEE
Q 002446 90 QVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVS--RYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLV 167 (921)
Q Consensus 90 ~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS--~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLA 167 (921)
=|..++|.+ ||. ++..+|.++.+-+||=.+...+.++-+ .|.|.|..+.++|+. .. ++
T Consensus 192 FV~~VRysP---DG~---~Fat~gsDgki~iyDGktge~vg~l~~~~aHkGsIfalsWsPDs-------------~~-~~ 251 (603)
T KOG0318|consen 192 FVNCVRYSP---DGS---RFATAGSDGKIYIYDGKTGEKVGELEDSDAHKGSIFALSWSPDS-------------TQ-FL 251 (603)
T ss_pred ceeeEEECC---CCC---eEEEecCCccEEEEcCCCccEEEEecCCCCccccEEEEEECCCC-------------ce-EE
Confidence 799999999 774 889999999999999998655666552 689999999999852 12 33
Q ss_pred EEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEE-----cCCEEEEEe
Q 002446 168 FCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRC-----SSRVVAICQ 242 (921)
Q Consensus 168 vv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~-----S~riLAVa~ 242 (921)
.|+. | .++||||..++++++++.+.+.|.+... +.++|.|++
T Consensus 252 T~Sa----------D-----------------------kt~KIWdVs~~slv~t~~~~~~v~dqqvG~lWqkd~lItVSl 298 (603)
T KOG0318|consen 252 TVSA----------D-----------------------KTIKIWDVSTNSLVSTWPMGSTVEDQQVGCLWQKDHLITVSL 298 (603)
T ss_pred EecC----------C-----------------------ceEEEEEeeccceEEEeecCCchhceEEEEEEeCCeEEEEEc
Confidence 3332 1 7899999999999999999776544433 467888899
Q ss_pred CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC--ceEEecCCC--ceecCCCccCCcccccccccccc
Q 002446 243 AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSP--VVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 243 d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~--~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
.+.|..+++..+..++++.+|.. ....+++++ .+|-.++.+ +..|..|.-....+.+.
T Consensus 299 ~G~in~ln~~d~~~~~~i~GHnK------------~ITaLtv~~d~~~i~SgsyDG~I~~W~~~~g~~~~~~g~------ 360 (603)
T KOG0318|consen 299 SGTINYLNPSDPSVLKVISGHNK------------SITALTVSPDGKTIYSGSYDGHINSWDSGSGTSDRLAGK------ 360 (603)
T ss_pred CcEEEEecccCCChhheeccccc------------ceeEEEEcCCCCEEEeeccCceEEEEecCCccccccccc------
Confidence 99999999999998888888743 122344444 344333333 22343332211111100
Q ss_pred cCCCcceeehhhhcchhhcc-ee------EecCCcc----------ccccccccccccCCC-------------------
Q 002446 319 ASNGSRVAHYAKESSKHLAA-GI------VNLGDLG----------YKKLSQYCSEFLPDS------------------- 362 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~Las-Gl------~~lGd~g----------~k~ls~y~~~~~p~~------------------- 362 (921)
..+..+...+...+.++.. |+ ..+.+.+ .+++. ....+++
T Consensus 361 -~h~nqI~~~~~~~~~~~~t~g~Dd~l~~~~~~~~~~t~~~~~~lg~QP~~---lav~~d~~~avv~~~~~iv~l~~~~~ 436 (603)
T KOG0318|consen 361 -GHTNQIKGMAASESGELFTIGWDDTLRVISLKDNGYTKSEVVKLGSQPKG---LAVLSDGGTAVVACISDIVLLQDQTK 436 (603)
T ss_pred -cccceEEEEeecCCCcEEEEecCCeEEEEecccCcccccceeecCCCcee---EEEcCCCCEEEEEecCcEEEEecCCc
Confidence 0111122222211111110 00 0011111 11100 0000000
Q ss_pred -------cCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc--eEEEeccCCCCeEEEEECCCCCEEEEEecCCC
Q 002446 363 -------QNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN--VIAQFRAHKSPISALCFDPSGILLVTASVQGH 433 (921)
Q Consensus 363 -------~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~--~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt 433 (921)
..+...|.... ...++-++.||.|+||.+.... ....+..|..+|++++|||||+|||+++..+.
T Consensus 437 ~~~~~~~y~~s~vAv~~~------~~~vaVGG~Dgkvhvysl~g~~l~ee~~~~~h~a~iT~vaySpd~~yla~~Da~rk 510 (603)
T KOG0318|consen 437 VSSIPIGYESSAVAVSPD------GSEVAVGGQDGKVHVYSLSGDELKEEAKLLEHRAAITDVAYSPDGAYLAAGDASRK 510 (603)
T ss_pred ceeeccccccceEEEcCC------CCEEEEecccceEEEEEecCCcccceeeeecccCCceEEEECCCCcEEEEeccCCc
Confidence 00000111000 1123456789999999998755 34567799999999999999999999999986
Q ss_pred EEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee-cCCCC
Q 002446 434 NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF-QPTDA 512 (921)
Q Consensus 434 ~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l-~~H~~ 512 (921)
+-+||+.+. ....-+.++++++|.+|+||||+++||+||.|.+|+||.+..+...+.+ .+|
T Consensus 511 -vv~yd~~s~---------------~~~~~~w~FHtakI~~~aWsP~n~~vATGSlDt~Viiysv~kP~~~i~iknAH-- 572 (603)
T KOG0318|consen 511 -VVLYDVASR---------------EVKTNRWAFHTAKINCVAWSPNNKLVATGSLDTNVIIYSVKKPAKHIIIKNAH-- 572 (603)
T ss_pred -EEEEEcccC---------------ceecceeeeeeeeEEEEEeCCCceEEEeccccceEEEEEccChhhheEecccc--
Confidence 899999875 2234456778899999999999999999999999999999988777665 456
Q ss_pred CcccccCCcCCccccCCCCCCCCCCCCcccccC
Q 002446 513 NFTTKHGAMAKSGVRWPPNLGLQMPNQQSLCAS 545 (921)
Q Consensus 513 ~~~~~~~~~~~~~~r~~~~s~l~~~~~~~l~~~ 545 (921)
++. +..+.|+++.++..+
T Consensus 573 --------------~~g-Vn~v~wlde~tvvSs 590 (603)
T KOG0318|consen 573 --------------LGG-VNSVAWLDESTVVSS 590 (603)
T ss_pred --------------ccC-ceeEEEecCceEEec
Confidence 444 667888888887543
No 11
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.84 E-value=4.8e-18 Score=173.65 Aligned_cols=251 Identities=18% Similarity=0.308 Sum_probs=184.9
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+|++.|..+.|.+ ++ .+|+.|. ++.+++||+++ ++....+..+..++..+.+.|. ..
T Consensus 7 ~h~~~i~~~~~~~---~~----~~l~~~~~~g~i~i~~~~~-~~~~~~~~~~~~~i~~~~~~~~--------------~~ 64 (289)
T cd00200 7 GHTGGVTCVAFSP---DG----KLLATGSGDGTIKVWDLET-GELLRTLKGHTGPVRDVAASAD--------------GT 64 (289)
T ss_pred ccCCCEEEEEEcC---CC----CEEEEeecCcEEEEEEeeC-CCcEEEEecCCcceeEEEECCC--------------CC
Confidence 6889999999988 54 4566565 66799999987 3455556667788877777763 13
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC--CEEEEE
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS--RVVAIC 241 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~--riLAVa 241 (921)
+|++++. .+.|++||+.+++.+..+.. ...|..+.+++ ++++++
T Consensus 65 ~l~~~~~---------------------------------~~~i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~ 111 (289)
T cd00200 65 YLASGSS---------------------------------DKTIRLWDLETGECVRTLTGHTSYVSSVAFSPDGRILSSS 111 (289)
T ss_pred EEEEEcC---------------------------------CCeEEEEEcCcccceEEEeccCCcEEEEEEcCCCCEEEEe
Confidence 5554442 16799999999888888775 45899999975 788877
Q ss_pred e-CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 242 Q-AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 242 ~-d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
. ++.|++||+.+++....+..+.. ++ ..+++.. +
T Consensus 112 ~~~~~i~~~~~~~~~~~~~~~~~~~---------------~i----~~~~~~~-------------~------------- 146 (289)
T cd00200 112 SRDKTIKVWDVETGKCLTTLRGHTD---------------WV----NSVAFSP-------------D------------- 146 (289)
T ss_pred cCCCeEEEEECCCcEEEEEeccCCC---------------cE----EEEEEcC-------------c-------------
Confidence 6 89999999998887776654321 01 1122220 0
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
+. .++.+..+|.|++||+.++
T Consensus 147 -~~----------------------------------------------------------~l~~~~~~~~i~i~d~~~~ 167 (289)
T cd00200 147 -GT----------------------------------------------------------FVASSSQDGTIKLWDLRTG 167 (289)
T ss_pred -CC----------------------------------------------------------EEEEEcCCCcEEEEEcccc
Confidence 00 0111224688999999999
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
+.+..+..|..+|.+++|+|+|+.|++++.+|. |++||+..+ ..+..+. ++ ...|.+++|+|+
T Consensus 168 ~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~-i~i~d~~~~--------------~~~~~~~-~~-~~~i~~~~~~~~ 230 (289)
T cd00200 168 KCVATLTGHTGEVNSVAFSPDGEKLLSSSSDGT-IKLWDLSTG--------------KCLGTLR-GH-ENGVNSVAFSPD 230 (289)
T ss_pred ccceeEecCccccceEEECCCcCEEEEecCCCc-EEEEECCCC--------------ceecchh-hc-CCceEEEEEcCC
Confidence 999999999999999999999999999999987 899999864 2222331 22 235999999999
Q ss_pred CCEEEEEeCCCcEEEEecCCCCCceeecCCCC
Q 002446 481 SNWIMISSSRGTSHLFAINPLGGSVNFQPTDA 512 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~ 512 (921)
+.++++++.||++++|++........+..|..
T Consensus 231 ~~~~~~~~~~~~i~i~~~~~~~~~~~~~~~~~ 262 (289)
T cd00200 231 GYLLASGSEDGTIRVWDLRTGECVQTLSGHTN 262 (289)
T ss_pred CcEEEEEcCCCcEEEEEcCCceeEEEccccCC
Confidence 99999999999999999988666666666643
No 12
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.83 E-value=6.6e-20 Score=201.46 Aligned_cols=242 Identities=19% Similarity=0.247 Sum_probs=184.3
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
...+|+++|..+.|-+.. ++ ..+...++++.+++|+++....+.+ +-.|...|.-++|-|..
T Consensus 212 ~l~gH~~~v~~~~fhP~~-~~---~~lat~s~Dgtvklw~~~~e~~l~~-l~gH~~RVs~VafHPsG------------- 273 (459)
T KOG0272|consen 212 TLRGHTSRVGAAVFHPVD-SD---LNLATASADGTVKLWKLSQETPLQD-LEGHLARVSRVAFHPSG------------- 273 (459)
T ss_pred EEeccccceeeEEEccCC-Cc---cceeeeccCCceeeeccCCCcchhh-hhcchhhheeeeecCCC-------------
Confidence 346899999999999933 12 2455556677799999987433333 44577778888887641
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCEEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRVVA 239 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~riLA 239 (921)
.+|+..+ .+.+-|+||+.|++.+...+. ...|++|+|. +-+++
T Consensus 274 -~~L~Tas---------------------------------fD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~ 319 (459)
T KOG0272|consen 274 -KFLGTAS---------------------------------FDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAA 319 (459)
T ss_pred -ceeeecc---------------------------------cccchhhcccccchhhHhhcccccccceeEecCCCceee
Confidence 2333222 126789999999998887765 5599999996 56777
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
. ++|..-+|||++|++++-.|.+|..+. ++ ++|+ |.
T Consensus 320 tGGlD~~~RvWDlRtgr~im~L~gH~k~I--------------~~-----V~fs-------------PN----------- 356 (459)
T KOG0272|consen 320 TGGLDSLGRVWDLRTGRCIMFLAGHIKEI--------------LS-----VAFS-------------PN----------- 356 (459)
T ss_pred ccCccchhheeecccCcEEEEecccccce--------------ee-----EeEC-------------CC-----------
Confidence 6 788899999999999999998874310 11 1222 10
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
| | ++++++.|++++|||+.
T Consensus 357 ---G-------------------------y---------------------------------~lATgs~Dnt~kVWDLR 375 (459)
T KOG0272|consen 357 ---G-------------------------Y---------------------------------HLATGSSDNTCKVWDLR 375 (459)
T ss_pred ---c-------------------------e---------------------------------EEeecCCCCcEEEeeec
Confidence 1 0 23456778999999999
Q ss_pred CCceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE
Q 002446 399 SKNVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF 477 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF 477 (921)
..+++.++.+|..-|+.|+|+| .|.+|+|||.|++ ++||...+. .++..| -||. .+|-++.+
T Consensus 376 ~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~TasyD~t-~kiWs~~~~--------------~~~ksL-aGHe-~kV~s~Di 438 (459)
T KOG0272|consen 376 MRSELYTIPAHSNLVSQVKYSPQEGYFLVTASYDNT-VKIWSTRTW--------------SPLKSL-AGHE-GKVISLDI 438 (459)
T ss_pred ccccceecccccchhhheEecccCCeEEEEcccCcc-eeeecCCCc--------------ccchhh-cCCc-cceEEEEe
Confidence 9999999999999999999999 7999999999987 899987764 345555 3665 46999999
Q ss_pred ccCCCEEEEEeCCCcEEEEe
Q 002446 478 SDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWd 497 (921)
||||+++++++.|+|+++|.
T Consensus 439 s~d~~~i~t~s~DRT~KLW~ 458 (459)
T KOG0272|consen 439 SPDSQAIATSSFDRTIKLWR 458 (459)
T ss_pred ccCCceEEEeccCceeeecc
Confidence 99999999999999999995
No 13
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.82 E-value=1.7e-17 Score=169.63 Aligned_cols=237 Identities=17% Similarity=0.299 Sum_probs=173.5
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
.+...|..+.|.. ++ +.+++.+.++.++|||++.. +....+..+.+.|.++.+.|. ..+
T Consensus 49 ~~~~~i~~~~~~~---~~---~~l~~~~~~~~i~i~~~~~~-~~~~~~~~~~~~i~~~~~~~~--------------~~~ 107 (289)
T cd00200 49 GHTGPVRDVAASA---DG---TYLASGSSDKTIRLWDLETG-ECVRTLTGHTSYVSSVAFSPD--------------GRI 107 (289)
T ss_pred cCCcceeEEEECC---CC---CEEEEEcCCCeEEEEEcCcc-cceEEEeccCCcEEEEEEcCC--------------CCE
Confidence 4566777888876 44 24555555777999999873 344445567788999888763 245
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcC--CEEEEEe
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSS--RVVAICQ 242 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~--riLAVa~ 242 (921)
++.++. .+.|++||+++++.+..+. +...|..+.+++ ++|+++.
T Consensus 108 ~~~~~~---------------------------------~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~ 154 (289)
T cd00200 108 LSSSSR---------------------------------DKTIKVWDVETGKCLTTLRGHTDWVNSVAFSPDGTFVASSS 154 (289)
T ss_pred EEEecC---------------------------------CCeEEEEECCCcEEEEEeccCCCcEEEEEEcCcCCEEEEEc
Confidence 544431 1569999999999988887 567899999975 7777766
Q ss_pred -CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 243 -AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 243 -d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
++.|++||+.+++.+..+..+.. ++ .-+++. |+
T Consensus 155 ~~~~i~i~d~~~~~~~~~~~~~~~---------------~i----~~~~~~-------------~~-------------- 188 (289)
T cd00200 155 QDGTIKLWDLRTGKCVATLTGHTG---------------EV----NSVAFS-------------PD-------------- 188 (289)
T ss_pred CCCcEEEEEccccccceeEecCcc---------------cc----ceEEEC-------------CC--------------
Confidence 89999999998877666654311 00 112222 00
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
+. .++.+..+|.|++||+.+++
T Consensus 189 ~~----------------------------------------------------------~l~~~~~~~~i~i~d~~~~~ 210 (289)
T cd00200 189 GE----------------------------------------------------------KLLSSSSDGTIKLWDLSTGK 210 (289)
T ss_pred cC----------------------------------------------------------EEEEecCCCcEEEEECCCCc
Confidence 00 01112236889999999999
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCC
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDS 481 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg 481 (921)
.+..++.|..+|.+++|+|++.++++++.+|+ |++||+..+ ..+..+. ++ ...|.+++|+|++
T Consensus 211 ~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~-i~i~~~~~~--------------~~~~~~~-~~-~~~i~~~~~~~~~ 273 (289)
T cd00200 211 CLGTLRGHENGVNSVAFSPDGYLLASGSEDGT-IRVWDLRTG--------------ECVQTLS-GH-TNSVTSLAWSPDG 273 (289)
T ss_pred eecchhhcCCceEEEEEcCCCcEEEEEcCCCc-EEEEEcCCc--------------eeEEEcc-cc-CCcEEEEEECCCC
Confidence 99999999999999999999999999998887 899999864 3334443 33 3459999999999
Q ss_pred CEEEEEeCCCcEEEEe
Q 002446 482 NWIMISSSRGTSHLFA 497 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWd 497 (921)
++|++++.|++++||+
T Consensus 274 ~~l~~~~~d~~i~iw~ 289 (289)
T cd00200 274 KRLASGSADGTIRIWD 289 (289)
T ss_pred CEEEEecCCCeEEecC
Confidence 9999999999999996
No 14
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.81 E-value=4.2e-18 Score=197.05 Aligned_cols=248 Identities=18% Similarity=0.301 Sum_probs=178.8
Q ss_pred CcEEEEEEecccCCCCCCCeEEEEEccC--cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEE
Q 002446 89 DQVLWAGFDKLESEAGATRRVLLLGYRS--GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLL 166 (921)
Q Consensus 89 d~V~w~~Fd~~~~d~~~~~~vLllG~~~--GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLL 166 (921)
-.|+-+.|+. .| .-|++|... .+-||+...-.=+.+ ...|-..+.++++.|+. .++
T Consensus 308 ~~I~t~~~N~---tG----DWiA~g~~klgQLlVweWqsEsYVlK-QQgH~~~i~~l~YSpDg--------------q~i 365 (893)
T KOG0291|consen 308 QKILTVSFNS---TG----DWIAFGCSKLGQLLVWEWQSESYVLK-QQGHSDRITSLAYSPDG--------------QLI 365 (893)
T ss_pred ceeeEEEecc---cC----CEEEEcCCccceEEEEEeeccceeee-ccccccceeeEEECCCC--------------cEE
Confidence 3477777776 44 578888876 578999876211111 23566789999998852 344
Q ss_pred EEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEc--CCEEEE-Ee
Q 002446 167 VFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--SRVVAI-CQ 242 (921)
Q Consensus 167 Avv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~riLAV-a~ 242 (921)
|..++ | ++|||||..+|-|+.++. +.+.|.+|.|. ++.|.. ++
T Consensus 366 aTG~e----------D-----------------------gKVKvWn~~SgfC~vTFteHts~Vt~v~f~~~g~~llssSL 412 (893)
T KOG0291|consen 366 ATGAE----------D-----------------------GKVKVWNTQSGFCFVTFTEHTSGVTAVQFTARGNVLLSSSL 412 (893)
T ss_pred EeccC----------C-----------------------CcEEEEeccCceEEEEeccCCCceEEEEEEecCCEEEEeec
Confidence 42221 2 789999999999999985 67899999996 555554 89
Q ss_pred CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCC
Q 002446 243 AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNG 322 (921)
Q Consensus 243 d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g 322 (921)
|++|+.||+...++-+|+.. |.+ +.+..+|+ - | .|
T Consensus 413 DGtVRAwDlkRYrNfRTft~-P~p----------~Qfscvav-------D-------------~--------------sG 447 (893)
T KOG0291|consen 413 DGTVRAWDLKRYRNFRTFTS-PEP----------IQFSCVAV-------D-------------P--------------SG 447 (893)
T ss_pred CCeEEeeeecccceeeeecC-CCc----------eeeeEEEE-------c-------------C--------------CC
Confidence 99999999999988877643 322 11222222 1 0 02
Q ss_pred cceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCce
Q 002446 323 SRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNV 402 (921)
Q Consensus 323 ~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~ 402 (921)
.+|- +.+...-.|.||++++|++
T Consensus 448 elV~---------------------------------------------------------AG~~d~F~IfvWS~qTGql 470 (893)
T KOG0291|consen 448 ELVC---------------------------------------------------------AGAQDSFEIFVWSVQTGQL 470 (893)
T ss_pred CEEE---------------------------------------------------------eeccceEEEEEEEeecCee
Confidence 2210 0011224699999999999
Q ss_pred EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCC
Q 002446 403 IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSN 482 (921)
Q Consensus 403 l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~ 482 (921)
+..+.+|.+||.+|+|+|+|.+||++|.|.| ||+||+-.. .+.+ -++. ....+..++|+|||+
T Consensus 471 lDiLsGHEgPVs~l~f~~~~~~LaS~SWDkT-VRiW~if~s----------~~~v---Etl~---i~sdvl~vsfrPdG~ 533 (893)
T KOG0291|consen 471 LDILSGHEGPVSGLSFSPDGSLLASGSWDKT-VRIWDIFSS----------SGTV---ETLE---IRSDVLAVSFRPDGK 533 (893)
T ss_pred eehhcCCCCcceeeEEccccCeEEeccccce-EEEEEeecc----------Ccee---eeEe---eccceeEEEEcCCCC
Confidence 9999999999999999999999999999987 999999763 0112 2332 123589999999999
Q ss_pred EEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 483 WIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 483 ~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
-||+++.||.|-+||+......-++.+-
T Consensus 534 elaVaTldgqItf~d~~~~~q~~~Idgr 561 (893)
T KOG0291|consen 534 ELAVATLDGQITFFDIKEAVQVGSIDGR 561 (893)
T ss_pred eEEEEEecceEEEEEhhhceeeccccch
Confidence 9999999999999999987776666553
No 15
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.80 E-value=2.6e-18 Score=186.32 Aligned_cols=255 Identities=12% Similarity=0.201 Sum_probs=192.0
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
..+|.+-|.-++|+. .| ++|+.+..+- +++||.+..-.+.+.+.+|+-.|.++.++|..
T Consensus 146 LrGHt~sv~di~~~a---~G----k~l~tcSsDl~~~LWd~~~~~~c~ks~~gh~h~vS~V~f~P~g------------- 205 (406)
T KOG0295|consen 146 LRGHTDSVFDISFDA---SG----KYLATCSSDLSAKLWDFDTFFRCIKSLIGHEHGVSSVFFLPLG------------- 205 (406)
T ss_pred hhccccceeEEEEec---Cc----cEEEecCCccchhheeHHHHHHHHHHhcCcccceeeEEEEecC-------------
Confidence 347888899999988 55 7888888776 99999998555666778899999999999841
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCEEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRVVA 239 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~riLA 239 (921)
..|+.|+. +.+|+.|++.||.++.++.- +..|..|+.+ +.++|
T Consensus 206 -d~ilS~sr---------------------------------D~tik~We~~tg~cv~t~~~h~ewvr~v~v~~DGti~A 251 (406)
T KOG0295|consen 206 -DHILSCSR---------------------------------DNTIKAWECDTGYCVKTFPGHSEWVRMVRVNQDGTIIA 251 (406)
T ss_pred -Ceeeeccc---------------------------------ccceeEEecccceeEEeccCchHhEEEEEecCCeeEEE
Confidence 34444442 27899999999999999976 5689999997 57788
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
. +.+.++++|-+.+++|+..+..|.-+. ..+|++..... |..
T Consensus 252 s~s~dqtl~vW~~~t~~~k~~lR~hEh~v-------------------Eci~wap~~~~--------~~i---------- 294 (406)
T KOG0295|consen 252 SCSNDQTLRVWVVATKQCKAELREHEHPV-------------------ECIAWAPESSY--------PSI---------- 294 (406)
T ss_pred ecCCCceEEEEEeccchhhhhhhccccce-------------------EEEEecccccC--------cch----------
Confidence 7 567799999999998877776653211 11233311000 000
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
.+ + .+..++ + ..+..+..|++|++||+.
T Consensus 295 --~~--------------a---------------------t~~~~~------------~---~~l~s~SrDktIk~wdv~ 322 (406)
T KOG0295|consen 295 --SE--------------A---------------------TGSTNG------------G---QVLGSGSRDKTIKIWDVS 322 (406)
T ss_pred --hh--------------c---------------------cCCCCC------------c---cEEEeecccceEEEEecc
Confidence 00 0 000000 0 012345678999999999
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
++.++-++.+|..-|..++|+|-|+||+++.+|++ +||||+... +++.++. . +...|+++.|.
T Consensus 323 tg~cL~tL~ghdnwVr~~af~p~Gkyi~ScaDDkt-lrvwdl~~~--------------~cmk~~~-a-h~hfvt~lDfh 385 (406)
T KOG0295|consen 323 TGMCLFTLVGHDNWVRGVAFSPGGKYILSCADDKT-LRVWDLKNL--------------QCMKTLE-A-HEHFVTSLDFH 385 (406)
T ss_pred CCeEEEEEecccceeeeeEEcCCCeEEEEEecCCc-EEEEEeccc--------------eeeeccC-C-CcceeEEEecC
Confidence 99999999999999999999999999999999998 899999975 5666654 2 33459999999
Q ss_pred cCCCEEEEEeCCCcEEEEec
Q 002446 479 DDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi 498 (921)
.+.-|+.+|+-|.|++||.-
T Consensus 386 ~~~p~VvTGsVdqt~KvwEc 405 (406)
T KOG0295|consen 386 KTAPYVVTGSVDQTVKVWEC 405 (406)
T ss_pred CCCceEEeccccceeeeeec
Confidence 99999999999999999963
No 16
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.79 E-value=6.8e-17 Score=199.36 Aligned_cols=235 Identities=14% Similarity=0.196 Sum_probs=162.8
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
.++..++++.++|||++. +.....+..|.+.|..+.+.|. ...+|+.++. |
T Consensus 547 ~las~~~Dg~v~lWd~~~-~~~~~~~~~H~~~V~~l~~~p~-------------~~~~L~Sgs~----------D----- 597 (793)
T PLN00181 547 QVASSNFEGVVQVWDVAR-SQLVTEMKEHEKRVWSIDYSSA-------------DPTLLASGSD----------D----- 597 (793)
T ss_pred EEEEEeCCCeEEEEECCC-CeEEEEecCCCCCEEEEEEcCC-------------CCCEEEEEcC----------C-----
Confidence 455566677799999987 4455566779999999999752 1135554432 2
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEEE-EeCCEEEEEECCCCc-EEEEEec
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVAI-CQAAQVHCFDAATLE-IEYAILT 262 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLAV-a~d~~I~IwDl~T~~-~l~tL~t 262 (921)
++|++||+++++.+.++.....|..+.|+ +++||+ +.++.|++||+.+.+ .+.++..
T Consensus 598 ------------------g~v~iWd~~~~~~~~~~~~~~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~~~~~~~~~ 659 (793)
T PLN00181 598 ------------------GSVKLWSINQGVSIGTIKTKANICCVQFPSESGRSLAFGSADHKVYYYDLRNPKLPLCTMIG 659 (793)
T ss_pred ------------------CEEEEEECCCCcEEEEEecCCCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCCccceEecC
Confidence 68999999999999999988899999984 567776 678899999998765 2344433
Q ss_pred CCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEe
Q 002446 263 NPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVN 342 (921)
Q Consensus 263 ~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~ 342 (921)
|.. ++ .+++|.+ +
T Consensus 660 h~~---------------~V----~~v~f~~----------------------------~-------------------- 672 (793)
T PLN00181 660 HSK---------------TV----SYVRFVD----------------------------S-------------------- 672 (793)
T ss_pred CCC---------------CE----EEEEEeC----------------------------C--------------------
Confidence 311 11 1222210 0
Q ss_pred cCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC------CceEEEeccCCCCeEEE
Q 002446 343 LGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS------KNVIAQFRAHKSPISAL 416 (921)
Q Consensus 343 lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s------~~~l~~~~aH~~pIsaL 416 (921)
..++++..||+|+|||+.. .+++..|.+|...+.++
T Consensus 673 --------------------------------------~~lvs~s~D~~ikiWd~~~~~~~~~~~~l~~~~gh~~~i~~v 714 (793)
T PLN00181 673 --------------------------------------STLVSSSTDNTLKLWDLSMSISGINETPLHSFMGHTNVKNFV 714 (793)
T ss_pred --------------------------------------CEEEEEECCCEEEEEeCCCCccccCCcceEEEcCCCCCeeEE
Confidence 0122345678999999974 36788999999999999
Q ss_pred EECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEE
Q 002446 417 CFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLF 496 (921)
Q Consensus 417 aFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVW 496 (921)
+|+|+|.+||+|+.||+ |+||+........+-... ....+..+.-..+...|.+++|+||+..|++++.||+|+||
T Consensus 715 ~~s~~~~~lasgs~D~~-v~iw~~~~~~~~~s~~~~---~~~~~~~~~~~~~~~~V~~v~ws~~~~~lva~~~dG~I~i~ 790 (793)
T PLN00181 715 GLSVSDGYIATGSETNE-VFVYHKAFPMPVLSYKFK---TIDPVSGLEVDDASQFISSVCWRGQSSTLVAANSTGNIKIL 790 (793)
T ss_pred EEcCCCCEEEEEeCCCE-EEEEECCCCCceEEEecc---cCCcccccccCCCCcEEEEEEEcCCCCeEEEecCCCcEEEE
Confidence 99999999999999997 899997653000000000 00000000001122349999999999999999999999999
Q ss_pred ec
Q 002446 497 AI 498 (921)
Q Consensus 497 di 498 (921)
++
T Consensus 791 ~~ 792 (793)
T PLN00181 791 EM 792 (793)
T ss_pred ec
Confidence 96
No 17
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.79 E-value=4.7e-17 Score=181.05 Aligned_cols=282 Identities=17% Similarity=0.290 Sum_probs=198.7
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcE-EEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGF-QVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~Gf-qVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
..-+|+.+.|+. +| .+|+.|.-+|+ +||+.+ |+....+..|.|||..++.-.+ ..+
T Consensus 234 ~nkdVT~L~Wn~---~G----~~LatG~~~G~~riw~~~--G~l~~tl~~HkgPI~slKWnk~--------------G~y 290 (524)
T KOG0273|consen 234 SNKDVTSLDWNN---DG----TLLATGSEDGEARIWNKD--GNLISTLGQHKGPIFSLKWNKK--------------GTY 290 (524)
T ss_pred ccCCcceEEecC---CC----CeEEEeecCcEEEEEecC--chhhhhhhccCCceEEEEEcCC--------------CCE
Confidence 345599999998 77 79999998885 999997 4677778899999999988532 123
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCE-EEEEEc-C-CEEEEEe
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPI-YSVRCS-S-RVVAICQ 242 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V-~sV~~S-~-riLAVa~ 242 (921)
|+..+ .++++-+||..+|+..+.+.|.+.. .+|.+- . .++....
T Consensus 291 ilS~~---------------------------------vD~ttilwd~~~g~~~q~f~~~s~~~lDVdW~~~~~F~ts~t 337 (524)
T KOG0273|consen 291 ILSGG---------------------------------VDGTTILWDAHTGTVKQQFEFHSAPALDVDWQSNDEFATSST 337 (524)
T ss_pred EEecc---------------------------------CCccEEEEeccCceEEEeeeeccCCccceEEecCceEeecCC
Confidence 32211 1267889999999999999997766 889984 3 4444467
Q ss_pred CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC--ceEEecCCC--ceecCCCccCCcccccccccccc
Q 002446 243 AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSP--VVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 243 d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~--~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
++.|++|-+..-++..++..|.++. +.+-..| ..||.++++ +.+|+.+.--..|
T Consensus 338 d~~i~V~kv~~~~P~~t~~GH~g~V------------~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~---------- 395 (524)
T KOG0273|consen 338 DGCIHVCKVGEDRPVKTFIGHHGEV------------NALKWNPTGSLLASCSDDGTLKIWSMGQSNSVH---------- 395 (524)
T ss_pred CceEEEEEecCCCcceeeecccCce------------EEEEECCCCceEEEecCCCeeEeeecCCCcchh----------
Confidence 8899999998888888888875431 2232232 456666544 4445432210000
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
.+-+ -.|++ |.....|++... .++ ..+..++++..+++|++||+.
T Consensus 396 ----~l~~-----Hskei-----------------~t~~wsp~g~v~---~n~------~~~~~l~sas~dstV~lwdv~ 440 (524)
T KOG0273|consen 396 ----DLQA-----HSKEI-----------------YTIKWSPTGPVT---SNP------NMNLMLASASFDSTVKLWDVE 440 (524)
T ss_pred ----hhhh-----hccce-----------------eeEeecCCCCcc---CCC------cCCceEEEeecCCeEEEEEcc
Confidence 0000 01111 111222332110 011 112345677889999999999
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
.+.+++.|..|+.||.+|+|||+|++||+++.||. |+||++.++ .+|+-.+|. .-|..++|+
T Consensus 441 ~gv~i~~f~kH~~pVysvafS~~g~ylAsGs~dg~-V~iws~~~~---------------~l~~s~~~~--~~Ifel~Wn 502 (524)
T KOG0273|consen 441 SGVPIHTLMKHQEPVYSVAFSPNGRYLASGSLDGC-VHIWSTKTG---------------KLVKSYQGT--GGIFELCWN 502 (524)
T ss_pred CCceeEeeccCCCceEEEEecCCCcEEEecCCCCe-eEeccccch---------------heeEeecCC--CeEEEEEEc
Confidence 99999999999999999999999999999999996 999999986 344444553 239999999
Q ss_pred cCCCEEEEEeCCCcEEEEecC
Q 002446 479 DDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi~ 499 (921)
-+|.+|+.+-.|+.+.|-|+.
T Consensus 503 ~~G~kl~~~~sd~~vcvldlr 523 (524)
T KOG0273|consen 503 AAGDKLGACASDGSVCVLDLR 523 (524)
T ss_pred CCCCEEEEEecCCCceEEEec
Confidence 999999999999999998874
No 18
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.78 E-value=1.1e-16 Score=169.84 Aligned_cols=260 Identities=13% Similarity=0.160 Sum_probs=188.8
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccC-cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRS-GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~-GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
..-+|-.+|....|-. |. +.|+.+..+ .+-|||.-+..+++ .+.-+-..|-.+++.|.
T Consensus 50 ~LkGH~~Ki~~~~ws~---Ds----r~ivSaSqDGklIvWDs~TtnK~h-aipl~s~WVMtCA~sPS------------- 108 (343)
T KOG0286|consen 50 TLKGHLNKIYAMDWST---DS----RRIVSASQDGKLIVWDSFTTNKVH-AIPLPSSWVMTCAYSPS------------- 108 (343)
T ss_pred EecccccceeeeEecC---Cc----CeEEeeccCCeEEEEEccccccee-EEecCceeEEEEEECCC-------------
Confidence 3457888999988877 54 455555544 57999999866554 44445566888888874
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCC--c----EEEEEe-CCCCEEEEEEc
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQ--S----YVHMLK-FRSPIYSVRCS 234 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg--~----~V~tL~-f~s~V~sV~~S 234 (921)
..++|+.+- ++...||++.+. + ..++|. +.+-+...+|-
T Consensus 109 -g~~VAcGGL---------------------------------dN~Csiy~ls~~d~~g~~~v~r~l~gHtgylScC~f~ 154 (343)
T KOG0286|consen 109 -GNFVACGGL---------------------------------DNKCSIYPLSTRDAEGNVRVSRELAGHTGYLSCCRFL 154 (343)
T ss_pred -CCeEEecCc---------------------------------CceeEEEecccccccccceeeeeecCccceeEEEEEc
Confidence 244543221 156778999866 2 333443 35567777773
Q ss_pred --CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccc
Q 002446 235 --SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQS 312 (921)
Q Consensus 235 --~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s 312 (921)
.++|..+.|.+..+||+++++.+..+.+|.. ..++| +.+ |.
T Consensus 155 dD~~ilT~SGD~TCalWDie~g~~~~~f~GH~g--------------DV~sl-----sl~-------------p~----- 197 (343)
T KOG0286|consen 155 DDNHILTGSGDMTCALWDIETGQQTQVFHGHTG--------------DVMSL-----SLS-------------PS----- 197 (343)
T ss_pred CCCceEecCCCceEEEEEcccceEEEEecCCcc--------------cEEEE-----ecC-------------CC-----
Confidence 5677778899999999999999888876621 11221 111 10
Q ss_pred cccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEE
Q 002446 313 RSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMV 392 (921)
Q Consensus 313 ~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V 392 (921)
+ ..+|+++..|+..
T Consensus 198 --------~----------------------------------------------------------~ntFvSg~cD~~a 211 (343)
T KOG0286|consen 198 --------D----------------------------------------------------------GNTFVSGGCDKSA 211 (343)
T ss_pred --------C----------------------------------------------------------CCeEEecccccce
Confidence 0 0135566778999
Q ss_pred EEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccE
Q 002446 393 IVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVI 472 (921)
Q Consensus 393 ~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I 472 (921)
+|||+..+.++++|.+|.+-|++|+|-|+|.-+||+|+|++ .|+||+... +.+..+..-.....|
T Consensus 212 klWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD~t-cRlyDlRaD--------------~~~a~ys~~~~~~gi 276 (343)
T KOG0286|consen 212 KLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDDAT-CRLYDLRAD--------------QELAVYSHDSIICGI 276 (343)
T ss_pred eeeeccCcceeEeecccccccceEEEccCCCeeeecCCCce-eEEEeecCC--------------cEEeeeccCcccCCc
Confidence 99999999999999999999999999999999999999998 899999975 222222222222349
Q ss_pred EEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 473 QDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 473 ~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
++++||.-|++|.+|..|.+++|||.-.....-.+.+|.+.+.
T Consensus 277 tSv~FS~SGRlLfagy~d~~c~vWDtlk~e~vg~L~GHeNRvS 319 (343)
T KOG0286|consen 277 TSVAFSKSGRLLFAGYDDFTCNVWDTLKGERVGVLAGHENRVS 319 (343)
T ss_pred eeEEEcccccEEEeeecCCceeEeeccccceEEEeeccCCeeE
Confidence 9999999999999999999999999988766667889976655
No 19
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.78 E-value=5.2e-17 Score=171.56 Aligned_cols=253 Identities=15% Similarity=0.251 Sum_probs=176.6
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEE-ccCcEEEEEccCC----CCeEEeeeeecCCEEEEEEecCCCCCccccC
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLG-YRSGFQVWDVEEA----DNVHDLVSRYDGPVSFMQMLPRPITSKRSRD 157 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG-~~~GfqVWDv~~~----~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d 157 (921)
-.++|+|.|.-.+... .+ +..|+.+ .+..+-+|++... |.+.+.+..|.-.|.-+.+.+
T Consensus 10 tl~gh~d~Vt~la~~~---~~---~~~l~sasrDk~ii~W~L~~dd~~~G~~~r~~~GHsH~v~dv~~s~---------- 73 (315)
T KOG0279|consen 10 TLEGHTDWVTALAIKI---KN---SDILVSASRDKTIIVWKLTSDDIKYGVPVRRLTGHSHFVSDVVLSS---------- 73 (315)
T ss_pred eecCCCceEEEEEeec---CC---CceEEEcccceEEEEEEeccCccccCceeeeeeccceEecceEEcc----------
Confidence 3568999999999887 33 2444444 4667899999763 122333333443444443333
Q ss_pred ccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC-
Q 002446 158 KFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS- 235 (921)
Q Consensus 158 ~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~- 235 (921)
+|..+.+ ...++++|+||+.+|+..+.|.. ..-|.+|+|++
T Consensus 74 -------------dg~~alS------------------------~swD~~lrlWDl~~g~~t~~f~GH~~dVlsva~s~d 116 (315)
T KOG0279|consen 74 -------------DGNFALS------------------------ASWDGTLRLWDLATGESTRRFVGHTKDVLSVAFSTD 116 (315)
T ss_pred -------------CCceEEe------------------------ccccceEEEEEecCCcEEEEEEecCCceEEEEecCC
Confidence 2211100 11448999999999988887764 56899999974
Q ss_pred --CEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccc
Q 002446 236 --RVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSR 313 (921)
Q Consensus 236 --riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~ 313 (921)
+++..+-|++|.+||..+ ++.+++..... ..|+-.- |++|...
T Consensus 117 n~qivSGSrDkTiklwnt~g-~ck~t~~~~~~--------------------~~WVscv----------rfsP~~~---- 161 (315)
T KOG0279|consen 117 NRQIVSGSRDKTIKLWNTLG-VCKYTIHEDSH--------------------REWVSCV----------RFSPNES---- 161 (315)
T ss_pred CceeecCCCcceeeeeeecc-cEEEEEecCCC--------------------cCcEEEE----------EEcCCCC----
Confidence 555558899999999875 45666643210 0111100 0011100
Q ss_pred ccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEE
Q 002446 314 SFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVI 393 (921)
Q Consensus 314 ~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~ 393 (921)
+..+++++.|++|+
T Consensus 162 ------------------------------------------------------------------~p~Ivs~s~DktvK 175 (315)
T KOG0279|consen 162 ------------------------------------------------------------------NPIIVSASWDKTVK 175 (315)
T ss_pred ------------------------------------------------------------------CcEEEEccCCceEE
Confidence 01234567789999
Q ss_pred EEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 394 VRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 394 IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
|||+.+.+....|.+|++.++.++|||||.++|+|+.||. +.+||+..+ +++|.|.- ...|.
T Consensus 176 vWnl~~~~l~~~~~gh~~~v~t~~vSpDGslcasGgkdg~-~~LwdL~~~--------------k~lysl~a---~~~v~ 237 (315)
T KOG0279|consen 176 VWNLRNCQLRTTFIGHSGYVNTVTVSPDGSLCASGGKDGE-AMLWDLNEG--------------KNLYSLEA---FDIVN 237 (315)
T ss_pred EEccCCcchhhccccccccEEEEEECCCCCEEecCCCCce-EEEEEccCC--------------ceeEeccC---CCeEe
Confidence 9999999999999999999999999999999999999997 899999986 67888842 24599
Q ss_pred EEEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 474 DISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
+++|+|+-.||+.+... .|+|||+.+......++
T Consensus 238 sl~fspnrywL~~at~~-sIkIwdl~~~~~v~~l~ 271 (315)
T KOG0279|consen 238 SLCFSPNRYWLCAATAT-SIKIWDLESKAVVEELK 271 (315)
T ss_pred eEEecCCceeEeeccCC-ceEEEeccchhhhhhcc
Confidence 99999999999888755 49999999876665554
No 20
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.77 E-value=1e-16 Score=186.20 Aligned_cols=251 Identities=18% Similarity=0.258 Sum_probs=185.6
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEE-ccCcEEEEEccCCC-CeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLG-YRSGFQVWDVEEAD-NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG-~~~GfqVWDv~~~~-~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
++.-|..+.|-. ++ +.|+.+ .+.-+.+|+..... +....+..|+-.|+.+++.|++ .
T Consensus 158 ~~~sv~~~~fs~---~g----~~l~~~~~~~~i~~~~~~~~~~~~~~~l~~h~~~v~~~~fs~d~--------------~ 216 (456)
T KOG0266|consen 158 ECPSVTCVDFSP---DG----RALAAASSDGLIRIWKLEGIKSNLLRELSGHTRGVSDVAFSPDG--------------S 216 (456)
T ss_pred ccCceEEEEEcC---CC----CeEEEccCCCcEEEeecccccchhhccccccccceeeeEECCCC--------------c
Confidence 366788888877 66 345555 56668999996643 1333347789999999998852 1
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEEC-CCCcEEEEEe-CCCCEEEEEEc--CCEEEE
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSL-RSQSYVHMLK-FRSPIYSVRCS--SRVVAI 240 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL-~Tg~~V~tL~-f~s~V~sV~~S--~riLAV 240 (921)
+|+-+.. +.+||+||+ ..+.++++|+ +...|+++.|+ +++|+.
T Consensus 217 ~l~s~s~---------------------------------D~tiriwd~~~~~~~~~~l~gH~~~v~~~~f~p~g~~i~S 263 (456)
T KOG0266|consen 217 YLLSGSD---------------------------------DKTLRIWDLKDDGRNLKTLKGHSTYVTSVAFSPDGNLLVS 263 (456)
T ss_pred EEEEecC---------------------------------CceEEEeeccCCCeEEEEecCCCCceEEEEecCCCCEEEE
Confidence 3322221 278999999 5558999997 46799999997 456665
Q ss_pred -EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccccc
Q 002446 241 -CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFA 319 (921)
Q Consensus 241 -a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~ 319 (921)
+.|++|+|||+.+++++.++.+|... |. -++|.. +
T Consensus 264 gs~D~tvriWd~~~~~~~~~l~~hs~~---------------is----~~~f~~-------------d------------ 299 (456)
T KOG0266|consen 264 GSDDGTVRIWDVRTGECVRKLKGHSDG---------------IS----GLAFSP-------------D------------ 299 (456)
T ss_pred ecCCCcEEEEeccCCeEEEeeeccCCc---------------eE----EEEECC-------------C------------
Confidence 78999999999999999999887431 11 123321 0
Q ss_pred CCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC
Q 002446 320 SNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS 399 (921)
Q Consensus 320 s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s 399 (921)
|. .++++..+|.|+|||+.+
T Consensus 300 --~~----------------------------------------------------------~l~s~s~d~~i~vwd~~~ 319 (456)
T KOG0266|consen 300 --GN----------------------------------------------------------LLVSASYDGTIRVWDLET 319 (456)
T ss_pred --CC----------------------------------------------------------EEEEcCCCccEEEEECCC
Confidence 10 112235589999999999
Q ss_pred Cc--eEEEeccCCCC--eEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc--cEE
Q 002446 400 KN--VIAQFRAHKSP--ISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA--VIQ 473 (921)
Q Consensus 400 ~~--~l~~~~aH~~p--IsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a--~I~ 473 (921)
+. ++..+..+..+ +++++|+|+|++|+++..|++ +++||+..+ ..+ ...+++... .+.
T Consensus 320 ~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d~~-~~~w~l~~~--------------~~~-~~~~~~~~~~~~~~ 383 (456)
T KOG0266|consen 320 GSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLDRT-LKLWDLRSG--------------KSV-GTYTGHSNLVRCIF 383 (456)
T ss_pred CceeeeecccCCCCCCceeEEEECCCCcEEEEecCCCe-EEEEEccCC--------------cce-eeecccCCcceeEe
Confidence 99 67888888766 999999999999999999987 999999875 111 122344443 466
Q ss_pred EEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCC
Q 002446 474 DISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTD 511 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~ 511 (921)
+..++++++|+.+|+.|++|++|++.+......+.+|.
T Consensus 384 ~~~~~~~~~~i~sg~~d~~v~~~~~~s~~~~~~l~~h~ 421 (456)
T KOG0266|consen 384 SPTLSTGGKLIYSGSEDGSVYVWDSSSGGILQRLEGHS 421 (456)
T ss_pred cccccCCCCeEEEEeCCceEEEEeCCccchhhhhcCCC
Confidence 77779999999999999999999999987778888983
No 21
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.77 E-value=3.4e-17 Score=174.30 Aligned_cols=271 Identities=13% Similarity=0.141 Sum_probs=192.0
Q ss_pred hhccccccCCCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCc
Q 002446 74 SVASSIVERDDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSK 153 (921)
Q Consensus 74 ~~~~s~~~~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~ 153 (921)
++.+.+- ...+|+..|.-+.|++ +|. .++..|++..+-+|++..--+-.-.+..|.|.|--+.+.++
T Consensus 35 ~l~ap~m--~l~gh~geI~~~~F~P---~gs---~~aSgG~Dr~I~LWnv~gdceN~~~lkgHsgAVM~l~~~~d----- 101 (338)
T KOG0265|consen 35 SLQAPIM--LLPGHKGEIYTIKFHP---DGS---CFASGGSDRAIVLWNVYGDCENFWVLKGHSGAVMELHGMRD----- 101 (338)
T ss_pred cccchhh--hcCCCcceEEEEEECC---CCC---eEeecCCcceEEEEeccccccceeeeccccceeEeeeeccC-----
Confidence 3444443 3568999999999999 662 45556678889999976422222346688899988887653
Q ss_pred cccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEE-EEE
Q 002446 154 RSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIY-SVR 232 (921)
Q Consensus 154 ~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~-sV~ 232 (921)
...|..|+. | ++|+.||.++|++++.++....+. ++.
T Consensus 102 ---------~s~i~S~gt----------D-----------------------k~v~~wD~~tG~~~rk~k~h~~~vNs~~ 139 (338)
T KOG0265|consen 102 ---------GSHILSCGT----------D-----------------------KTVRGWDAETGKRIRKHKGHTSFVNSLD 139 (338)
T ss_pred ---------CCEEEEecC----------C-----------------------ceEEEEecccceeeehhccccceeeecC
Confidence 133444432 2 789999999999999888765444 443
Q ss_pred Ec---CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcc
Q 002446 233 CS---SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQH 308 (921)
Q Consensus 233 ~S---~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~ 308 (921)
-+ ..+|.. +.|+++++||+++.+++++++.. ++ -.|+ ++..
T Consensus 140 p~rrg~~lv~SgsdD~t~kl~D~R~k~~~~t~~~k-----yq----------ltAv-----~f~d--------------- 184 (338)
T KOG0265|consen 140 PSRRGPQLVCSGSDDGTLKLWDIRKKEAIKTFENK-----YQ----------LTAV-----GFKD--------------- 184 (338)
T ss_pred ccccCCeEEEecCCCceEEEEeecccchhhccccc-----ee----------EEEE-----Eecc---------------
Confidence 33 345555 56789999999987776665321 10 0111 1110
Q ss_pred cccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCC
Q 002446 309 LMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADN 388 (921)
Q Consensus 309 l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~ 388 (921)
. ++. ..++.-
T Consensus 185 -----------------------~-----------s~q------------------------------------v~sggI 194 (338)
T KOG0265|consen 185 -----------------------T-----------SDQ------------------------------------VISGGI 194 (338)
T ss_pred -----------------------c-----------ccc------------------------------------eeeccc
Confidence 0 000 012334
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
++.|++||+..+..+.++++|..+|+.|..+|+|.+|.+-+-|.+ +++||+.+..+ ..+++..+.-+.+
T Consensus 195 dn~ikvWd~r~~d~~~~lsGh~DtIt~lsls~~gs~llsnsMd~t-vrvwd~rp~~p----------~~R~v~if~g~~h 263 (338)
T KOG0265|consen 195 DNDIKVWDLRKNDGLYTLSGHADTITGLSLSRYGSFLLSNSMDNT-VRVWDVRPFAP----------SQRCVKIFQGHIH 263 (338)
T ss_pred cCceeeeccccCcceEEeecccCceeeEEeccCCCccccccccce-EEEEEecccCC----------CCceEEEeecchh
Confidence 678999999999999999999999999999999999999999976 89999998521 1244444432222
Q ss_pred ccc--EEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 469 NAV--IQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 469 ~a~--I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
.-. ...++|||+++++..||.|..++|||....+-...+-+|.+.++
T Consensus 264 nfeknlL~cswsp~~~~i~ags~dr~vyvwd~~~r~~lyklpGh~gsvn 312 (338)
T KOG0265|consen 264 NFEKNLLKCSWSPNGTKITAGSADRFVYVWDTTSRRILYKLPGHYGSVN 312 (338)
T ss_pred hhhhhcceeeccCCCCccccccccceEEEeecccccEEEEcCCcceeEE
Confidence 211 56789999999999999999999999988777788899977666
No 22
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.77 E-value=5e-17 Score=180.83 Aligned_cols=198 Identities=18% Similarity=0.304 Sum_probs=142.0
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEcC--CEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS--RVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~--riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
+.+|+|+. +|.++.+|.+ +.+|.++++++ .+|+. ..|+++.+||..+++..+.+.-|..+
T Consensus 257 G~~riw~~-~G~l~~tl~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q~f~~~s~~--------------- 320 (524)
T KOG0273|consen 257 GEARIWNK-DGNLISTLGQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQQFEFHSAP--------------- 320 (524)
T ss_pred cEEEEEec-CchhhhhhhccCCceEEEEEcCCCCEEEeccCCccEEEEeccCceEEEeeeeccCC---------------
Confidence 78999997 5677777765 78999999984 45555 78999999999999887766544210
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
++.-.|. ++.
T Consensus 321 -~lDVdW~------------------------------------------------------~~~--------------- 330 (524)
T KOG0273|consen 321 -ALDVDWQ------------------------------------------------------SND--------------- 330 (524)
T ss_pred -ccceEEe------------------------------------------------------cCc---------------
Confidence 1100111 110
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
.|++...+|.|+|+-+...+++.+|.+|.++|.+|.|+|.|.+|+|||+|+| ++||...
T Consensus 331 --------------------~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~tg~LLaS~SdD~T-lkiWs~~ 389 (524)
T KOG0273|consen 331 --------------------EFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNPTGSLLASCSDDGT-LKIWSMG 389 (524)
T ss_pred --------------------eEeecCCCceEEEEEecCCCcceeeecccCceEEEEECCCCceEEEecCCCe-eEeeecC
Confidence 1233455789999999999999999999999999999999999999999998 8999865
Q ss_pred CCCC-----CCC---------C--------------ccCCCCceeEEEEEeccc-------ccccEEEEEEccCCCEEEE
Q 002446 442 PGIL-----GTS---------S--------------ACDAGTSYVHLYRLQRGL-------TNAVIQDISFSDDSNWIMI 486 (921)
Q Consensus 442 ~g~~-----~~~---------s--------------~~~~~~~~~~l~~l~RG~-------t~a~I~sIaFSPDg~~LAs 486 (921)
.... +.+ + +.........+|...+|. +...|++++|||||+|+|+
T Consensus 390 ~~~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sas~dstV~lwdv~~gv~i~~f~kH~~pVysvafS~~g~ylAs 469 (524)
T KOG0273|consen 390 QSNSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASASFDSTVKLWDVESGVPIHTLMKHQEPVYSVAFSPNGRYLAS 469 (524)
T ss_pred CCcchhhhhhhccceeeEeecCCCCccCCCcCCceEEEeecCCeEEEEEccCCceeEeeccCCCceEEEEecCCCcEEEe
Confidence 4311 000 0 000011222333333321 3356999999999999999
Q ss_pred EeCCCcEEEEecCCCCCceeecCC
Q 002446 487 SSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 487 gS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
|+.||.||||++..+.-...+++-
T Consensus 470 Gs~dg~V~iws~~~~~l~~s~~~~ 493 (524)
T KOG0273|consen 470 GSLDGCVHIWSTKTGKLVKSYQGT 493 (524)
T ss_pred cCCCCeeEeccccchheeEeecCC
Confidence 999999999999887666666554
No 23
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.76 E-value=2e-17 Score=179.50 Aligned_cols=252 Identities=15% Similarity=0.258 Sum_probs=190.5
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVR 163 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~r 163 (921)
.+++-+|..+-|-+ + .-+++++. +..+++||.++ +++.+-+.+|...|-.+.+-- ..
T Consensus 105 ~g~r~~vt~v~~hp---~----~~~v~~as~d~tikv~D~~t-g~~e~~LrGHt~sv~di~~~a--------------~G 162 (406)
T KOG0295|consen 105 AGHRSSVTRVIFHP---S----EALVVSASEDATIKVFDTET-GELERSLRGHTDSVFDISFDA--------------SG 162 (406)
T ss_pred hccccceeeeeecc---C----ceEEEEecCCceEEEEEccc-hhhhhhhhccccceeEEEEec--------------Cc
Confidence 36788899999977 2 24555554 55699999999 677777888887777776632 23
Q ss_pred CEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCC-CcEEEEEe-CCCCEEEEEEc--CCEEE
Q 002446 164 PLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRS-QSYVHMLK-FRSPIYSVRCS--SRVVA 239 (921)
Q Consensus 164 PLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~T-g~~V~tL~-f~s~V~sV~~S--~riLA 239 (921)
-+||-|+. | -.+++||+.+ .++++++. +...|.+|.|- +.+|+
T Consensus 163 k~l~tcSs----------D-----------------------l~~~LWd~~~~~~c~ks~~gh~h~vS~V~f~P~gd~il 209 (406)
T KOG0295|consen 163 KYLATCSS----------D-----------------------LSAKLWDFDTFFRCIKSLIGHEHGVSSVFFLPLGDHIL 209 (406)
T ss_pred cEEEecCC----------c-----------------------cchhheeHHHHHHHHHHhcCcccceeeEEEEecCCeee
Confidence 45555542 2 2389999987 46666654 45688888884 56666
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
. +-|++|+.||+.|+-+++++..|+. . + |.++.. ..
T Consensus 210 S~srD~tik~We~~tg~cv~t~~~h~e------------w---v----r~v~v~-------~D----------------- 246 (406)
T KOG0295|consen 210 SCSRDNTIKAWECDTGYCVKTFPGHSE------------W---V----RMVRVN-------QD----------------- 246 (406)
T ss_pred ecccccceeEEecccceeEEeccCchH------------h---E----EEEEec-------CC-----------------
Confidence 6 6789999999999999998876532 0 0 111110 00
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
|. .+++++.+.+|++|-+.
T Consensus 247 ---Gt----------------------------------------------------------i~As~s~dqtl~vW~~~ 265 (406)
T KOG0295|consen 247 ---GT----------------------------------------------------------IIASCSNDQTLRVWVVA 265 (406)
T ss_pred ---ee----------------------------------------------------------EEEecCCCceEEEEEec
Confidence 00 12344567899999999
Q ss_pred CCceEEEeccCCCCeEEEEECCC---------------CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 399 SKNVIAQFRAHKSPISALCFDPS---------------GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPd---------------GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
++++...|+.|..+|-|++|-|. |.+|+++|.|++ ||+||+.++ .++.+|
T Consensus 266 t~~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDkt-Ik~wdv~tg--------------~cL~tL 330 (406)
T KOG0295|consen 266 TKQCKAELREHEHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKT-IKIWDVSTG--------------MCLFTL 330 (406)
T ss_pred cchhhhhhhccccceEEEEecccccCcchhhccCCCCCccEEEeecccce-EEEEeccCC--------------eEEEEE
Confidence 99999999999999999998663 369999999987 999999986 788898
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCC
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDA 512 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~ 512 (921)
-||.+. |.+++|+|-|+||++..+|+|+||||+....+..++..|..
T Consensus 331 -~ghdnw-Vr~~af~p~Gkyi~ScaDDktlrvwdl~~~~cmk~~~ah~h 377 (406)
T KOG0295|consen 331 -VGHDNW-VRGVAFSPGGKYILSCADDKTLRVWDLKNLQCMKTLEAHEH 377 (406)
T ss_pred -ecccce-eeeeEEcCCCeEEEEEecCCcEEEEEeccceeeeccCCCcc
Confidence 466554 99999999999999999999999999999999888887743
No 24
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.76 E-value=6e-16 Score=191.01 Aligned_cols=251 Identities=15% Similarity=0.161 Sum_probs=170.5
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCC---CCe-E--EeeeeecCCEEEEEEecCCCCCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEA---DNV-H--DLVSRYDGPVSFMQMLPRPITSKRSR 156 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~---~~~-~--elvS~~dG~Vr~v~~lP~P~~~~~~~ 156 (921)
+...|...|..+.|+. ++. .++..|.++.++|||++.. +.. . .+.-.+...|..+.+.|.
T Consensus 478 ~~~~~~~~V~~i~fs~---dg~---~latgg~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~-------- 543 (793)
T PLN00181 478 DLLNSSNLVCAIGFDR---DGE---FFATAGVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSY-------- 543 (793)
T ss_pred cccCCCCcEEEEEECC---CCC---EEEEEeCCCEEEEEECCcccccccccccceEEecccCceeeEEeccC--------
Confidence 3445888999999998 662 4445555667999998641 000 0 000112344555544331
Q ss_pred CccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc-
Q 002446 157 DKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS- 234 (921)
Q Consensus 157 d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S- 234 (921)
...+||.++. +++|++||+.+++.+..++. ...|++|+|+
T Consensus 544 -----~~~~las~~~---------------------------------Dg~v~lWd~~~~~~~~~~~~H~~~V~~l~~~p 585 (793)
T PLN00181 544 -----IKSQVASSNF---------------------------------EGVVQVWDVARSQLVTEMKEHEKRVWSIDYSS 585 (793)
T ss_pred -----CCCEEEEEeC---------------------------------CCeEEEEECCCCeEEEEecCCCCCEEEEEEcC
Confidence 1234443331 27899999999999988864 6789999996
Q ss_pred --CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccc
Q 002446 235 --SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQ 311 (921)
Q Consensus 235 --~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~ 311 (921)
+.+|++ +.|++|++||+.+++++.++..+.. .. .++|.+.
T Consensus 586 ~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~~~~~---------------v~-----~v~~~~~----------------- 628 (793)
T PLN00181 586 ADPTLLASGSDDGSVKLWSINQGVSIGTIKTKAN---------------IC-----CVQFPSE----------------- 628 (793)
T ss_pred CCCCEEEEEcCCCEEEEEECCCCcEEEEEecCCC---------------eE-----EEEEeCC-----------------
Confidence 356666 6789999999999988777653210 01 1222100
Q ss_pred ccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCE
Q 002446 312 SRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGM 391 (921)
Q Consensus 312 s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~ 391 (921)
.|. .++.+..+|.
T Consensus 629 ---------~g~----------------------------------------------------------~latgs~dg~ 641 (793)
T PLN00181 629 ---------SGR----------------------------------------------------------SLAFGSADHK 641 (793)
T ss_pred ---------CCC----------------------------------------------------------EEEEEeCCCe
Confidence 000 1223456789
Q ss_pred EEEEECCCCc-eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 392 VIVRDIVSKN-VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 392 V~IwDl~s~~-~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
|++||+.+.+ .+..+.+|..+|++++|. ++.+|+|++.||+ |+|||+.....+. ....+..+ .|+. .
T Consensus 642 I~iwD~~~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~s~D~~-ikiWd~~~~~~~~--------~~~~l~~~-~gh~-~ 709 (793)
T PLN00181 642 VYYYDLRNPKLPLCTMIGHSKTVSYVRFV-DSSTLVSSSTDNT-LKLWDLSMSISGI--------NETPLHSF-MGHT-N 709 (793)
T ss_pred EEEEECCCCCccceEecCCCCCEEEEEEe-CCCEEEEEECCCE-EEEEeCCCCcccc--------CCcceEEE-cCCC-C
Confidence 9999998765 577889999999999997 7889999999997 9999997531100 01234444 4554 4
Q ss_pred cEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 471 VIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.|.+++|+|++++||+|+.|++|+||+....
T Consensus 710 ~i~~v~~s~~~~~lasgs~D~~v~iw~~~~~ 740 (793)
T PLN00181 710 VKNFVGLSVSDGYIATGSETNEVFVYHKAFP 740 (793)
T ss_pred CeeEEEEcCCCCEEEEEeCCCEEEEEECCCC
Confidence 5899999999999999999999999997654
No 25
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.76 E-value=2.4e-17 Score=192.44 Aligned_cols=116 Identities=13% Similarity=0.241 Sum_probs=101.9
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
|+++..|++.++|......++..|.+|-+-|.|++|.|+..|+||+|.|.| +|+||+.++ .. .+
T Consensus 508 Fatas~D~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~t-VRlWDv~~G--------------~~-VR 571 (707)
T KOG0263|consen 508 FATASHDQTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRT-VRLWDVSTG--------------NS-VR 571 (707)
T ss_pred EEecCCCceeeeeecccCCchhhhcccccccceEEECCcccccccCCCCce-EEEEEcCCC--------------cE-EE
Confidence 345577889999999999999999999999999999999999999999977 999999987 22 23
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
+.+||+ +.|.+|+|||+|+|||+|+.||.|+|||+..+.....+.+|++.+.
T Consensus 572 iF~GH~-~~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~~~~~v~~l~~Ht~ti~ 623 (707)
T KOG0263|consen 572 IFTGHK-GPVTALAFSPCGRYLASGDEDGLIKIWDLANGSLVKQLKGHTGTIY 623 (707)
T ss_pred EecCCC-CceEEEEEcCCCceEeecccCCcEEEEEcCCCcchhhhhcccCcee
Confidence 447865 5699999999999999999999999999998877788999976665
No 26
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.75 E-value=1.8e-16 Score=184.28 Aligned_cols=190 Identities=19% Similarity=0.309 Sum_probs=150.0
Q ss_pred cEEEEEECCCCc--EEEEE-eCCCCEEEEEEc--CCEEEE-EeCCEEEEEEC-CCCcEEEEEecCCCccCCCCCCCCCcc
Q 002446 206 TVVHFYSLRSQS--YVHML-KFRSPIYSVRCS--SRVVAI-CQAAQVHCFDA-ATLEIEYAILTNPIVMGHPSAGGIGIG 278 (921)
Q Consensus 206 ~tVrIWDL~Tg~--~V~tL-~f~s~V~sV~~S--~riLAV-a~d~~I~IwDl-~T~~~l~tL~t~p~~~g~p~~~g~~i~ 278 (921)
+++++|++.+.+ +.+++ .+...|..++|+ +++|+. +.|.+|+|||+ ..+.+++++.+|....
T Consensus 181 ~~i~~~~~~~~~~~~~~~l~~h~~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l~gH~~~v----------- 249 (456)
T KOG0266|consen 181 GLIRIWKLEGIKSNLLRELSGHTRGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTLKGHSTYV----------- 249 (456)
T ss_pred CcEEEeecccccchhhccccccccceeeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEecCCCCce-----------
Confidence 789999997777 66666 456789999996 466666 67889999999 5568889998885421
Q ss_pred ccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccc
Q 002446 279 YGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEF 358 (921)
Q Consensus 279 ~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~ 358 (921)
. -++|. |+ |.
T Consensus 250 ---~-----~~~f~-------------p~--------------g~----------------------------------- 259 (456)
T KOG0266|consen 250 ---T-----SVAFS-------------PD--------------GN----------------------------------- 259 (456)
T ss_pred ---E-----EEEec-------------CC--------------CC-----------------------------------
Confidence 1 12333 11 00
Q ss_pred cCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEE
Q 002446 359 LPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIF 438 (921)
Q Consensus 359 ~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIW 438 (921)
.++++..|++|+|||+.+++++..|++|.++|++++|++||.+|++++.||. |+||
T Consensus 260 -----------------------~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~~~f~~d~~~l~s~s~d~~-i~vw 315 (456)
T KOG0266|consen 260 -----------------------LLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISGLAFSPDGNLLVSASYDGT-IRVW 315 (456)
T ss_pred -----------------------EEEEecCCCcEEEEeccCCeEEEeeeccCCceEEEEECCCCCEEEEcCCCcc-EEEE
Confidence 1234567899999999999999999999999999999999999999999987 9999
Q ss_pred eCCCCCCCCCCccCCCCceeEEEEEecccccc-cEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCC
Q 002446 439 KIIPGILGTSSACDAGTSYVHLYRLQRGLTNA-VIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDAN 513 (921)
Q Consensus 439 di~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a-~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~ 513 (921)
|+.++ ...++..+.. .... .+.+++|+|++++|++++.|+++++|++........+.+|...
T Consensus 316 d~~~~------------~~~~~~~~~~-~~~~~~~~~~~fsp~~~~ll~~~~d~~~~~w~l~~~~~~~~~~~~~~~ 378 (456)
T KOG0266|consen 316 DLETG------------SKLCLKLLSG-AENSAPVTSVQFSPNGKYLLSASLDRTLKLWDLRSGKSVGTYTGHSNL 378 (456)
T ss_pred ECCCC------------ceeeeecccC-CCCCCceeEEEECCCCcEEEEecCCCeEEEEEccCCcceeeecccCCc
Confidence 99986 1112344433 3333 6899999999999999999999999999998888888988554
No 27
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.73 E-value=4.7e-17 Score=169.57 Aligned_cols=199 Identities=20% Similarity=0.322 Sum_probs=154.8
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
.||--|.-+.|++ |. ..+|.-|.+.-+||||++......+-++.|.|.||.+.++-. ..-+
T Consensus 98 ~hkhivk~~af~~---ds---~~lltgg~ekllrvfdln~p~App~E~~ghtg~Ir~v~wc~e-------------D~~i 158 (334)
T KOG0278|consen 98 EHKHIVKAVAFSQ---DS---NYLLTGGQEKLLRVFDLNRPKAPPKEISGHTGGIRTVLWCHE-------------DKCI 158 (334)
T ss_pred hhhheeeeEEecc---cc---hhhhccchHHHhhhhhccCCCCCchhhcCCCCcceeEEEecc-------------CceE
Confidence 5788999999999 65 244444445567999999877666778899999999988731 1123
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEeC
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQA 243 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~d 243 (921)
|.. . ..++||+||.+||..+++|.|+++|.++.++ +++|.++..
T Consensus 159 LSS-a---------------------------------dd~tVRLWD~rTgt~v~sL~~~s~VtSlEvs~dG~ilTia~g 204 (334)
T KOG0278|consen 159 LSS-A---------------------------------DDKTVRLWDHRTGTEVQSLEFNSPVTSLEVSQDGRILTIAYG 204 (334)
T ss_pred Eee-c---------------------------------cCCceEEEEeccCcEEEEEecCCCCcceeeccCCCEEEEecC
Confidence 321 1 1278999999999999999999999999996 799999999
Q ss_pred CEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCc
Q 002446 244 AQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGS 323 (921)
Q Consensus 244 ~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~ 323 (921)
..|..||+.++..+...+-- | + + ..++ +.|.
T Consensus 205 ssV~Fwdaksf~~lKs~k~P-----~----------n-V-------~SAS----------L~P~---------------- 235 (334)
T KOG0278|consen 205 SSVKFWDAKSFGLLKSYKMP-----C----------N-V-------ESAS----------LHPK---------------- 235 (334)
T ss_pred ceeEEeccccccceeeccCc-----c----------c-c-------cccc----------ccCC----------------
Confidence 99999999999887665421 1 0 0 0010 0111
Q ss_pred ceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceE
Q 002446 324 RVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVI 403 (921)
Q Consensus 324 ~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l 403 (921)
. ..++.++.++.++.||..++..+
T Consensus 236 --------------------------------------k------------------~~fVaGged~~~~kfDy~TgeEi 259 (334)
T KOG0278|consen 236 --------------------------------------K------------------EFFVAGGEDFKVYKFDYNTGEEI 259 (334)
T ss_pred --------------------------------------C------------------ceEEecCcceEEEEEeccCCcee
Confidence 0 12345677899999999999998
Q ss_pred EEe-ccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 404 AQF-RAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 404 ~~~-~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
..+ ++|-+||-||.|+|||.+.|++|.||+ ||||.+.++
T Consensus 260 ~~~nkgh~gpVhcVrFSPdGE~yAsGSEDGT-irlWQt~~~ 299 (334)
T KOG0278|consen 260 GSYNKGHFGPVHCVRFSPDGELYASGSEDGT-IRLWQTTPG 299 (334)
T ss_pred eecccCCCCceEEEEECCCCceeeccCCCce-EEEEEecCC
Confidence 886 899999999999999999999999998 999999876
No 28
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.72 E-value=1.2e-17 Score=179.90 Aligned_cols=231 Identities=16% Similarity=0.274 Sum_probs=169.2
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
..+.|.++-+|. ..++.|. ++.++|||.++. .+..++..|.|.|-|+++-. |
T Consensus 196 ~skgVYClQYDD---------~kiVSGlrDnTikiWD~n~~-~c~~~L~GHtGSVLCLqyd~---------------r-- 248 (499)
T KOG0281|consen 196 NSKGVYCLQYDD---------EKIVSGLRDNTIKIWDKNSL-ECLKILTGHTGSVLCLQYDE---------------R-- 248 (499)
T ss_pred cCCceEEEEecc---------hhhhcccccCceEEeccccH-HHHHhhhcCCCcEEeeeccc---------------e--
Confidence 456688877765 3556666 778999999984 57778899999999998742 2
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcCCEEEE-EeC
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSSRVVAI-CQA 243 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~riLAV-a~d 243 (921)
++++++ ++.||++||..||++++++-+ -..|.-++|+..+++. +-|
T Consensus 249 -viisGS-------------------------------SDsTvrvWDv~tge~l~tlihHceaVLhlrf~ng~mvtcSkD 296 (499)
T KOG0281|consen 249 -VIVSGS-------------------------------SDSTVRVWDVNTGEPLNTLIHHCEAVLHLRFSNGYMVTCSKD 296 (499)
T ss_pred -EEEecC-------------------------------CCceEEEEeccCCchhhHHhhhcceeEEEEEeCCEEEEecCC
Confidence 234432 127899999999999998865 5689999999877777 667
Q ss_pred CEEEEEECCCCcEE---EEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 244 AQVHCFDAATLEIE---YAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 244 ~~I~IwDl~T~~~l---~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
..|.+||+.....+ +.|.+|- ..+|.+. |.
T Consensus 297 rsiaVWdm~sps~it~rrVLvGHr------------AaVNvVd-------fd---------------------------- 329 (499)
T KOG0281|consen 297 RSIAVWDMASPTDITLRRVLVGHR------------AAVNVVD-------FD---------------------------- 329 (499)
T ss_pred ceeEEEeccCchHHHHHHHHhhhh------------hheeeec-------cc----------------------------
Confidence 89999998754311 1111110 0000010 00
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
+ ..++++..|.+|++||+.++
T Consensus 330 ------------------------~-----------------------------------kyIVsASgDRTikvW~~st~ 350 (499)
T KOG0281|consen 330 ------------------------D-----------------------------------KYIVSASGDRTIKVWSTSTC 350 (499)
T ss_pred ------------------------c-----------------------------------ceEEEecCCceEEEEeccce
Confidence 0 01234556789999999999
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
+.+.++.+|.-.|.|+.+ .|+++++||.|.| ||+||+..| .++..| .||.. -|.+|-| |
T Consensus 351 efvRtl~gHkRGIAClQY--r~rlvVSGSSDnt-IRlwdi~~G--------------~cLRvL-eGHEe-LvRciRF--d 409 (499)
T KOG0281|consen 351 EFVRTLNGHKRGIACLQY--RDRLVVSGSSDNT-IRLWDIECG--------------ACLRVL-EGHEE-LVRCIRF--D 409 (499)
T ss_pred eeehhhhcccccceehhc--cCeEEEecCCCce-EEEEecccc--------------HHHHHH-hchHH-hhhheee--c
Confidence 999999999999999877 6899999999987 999999976 344344 35432 3889988 5
Q ss_pred CCEEEEEeCCCcEEEEecCCCCC
Q 002446 481 SNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
.+.+++|.-||+|+|||+...-.
T Consensus 410 ~krIVSGaYDGkikvWdl~aald 432 (499)
T KOG0281|consen 410 NKRIVSGAYDGKIKVWDLQAALD 432 (499)
T ss_pred CceeeeccccceEEEEecccccC
Confidence 78999999999999999987533
No 29
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.72 E-value=5.1e-16 Score=161.98 Aligned_cols=227 Identities=13% Similarity=0.201 Sum_probs=157.0
Q ss_pred CcEEEEEECCCCcEEEEEeCC-CCEEEEEEc--CCEEEEEeCCEEEEEECCCCc--EEEEEecCCCccCCCCCCCCCccc
Q 002446 205 PTVVHFYSLRSQSYVHMLKFR-SPIYSVRCS--SRVVAICQAAQVHCFDAATLE--IEYAILTNPIVMGHPSAGGIGIGY 279 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f~-s~V~sV~~S--~riLAVa~d~~I~IwDl~T~~--~l~tL~t~p~~~g~p~~~g~~i~~ 279 (921)
+.|||||-+.||.|..+++++ +.|.+++++ ++.||++..-+|++||+++.. .+.+++.+..
T Consensus 19 DhTIRfWqa~tG~C~rTiqh~dsqVNrLeiTpdk~~LAaa~~qhvRlyD~~S~np~Pv~t~e~h~k-------------- 84 (311)
T KOG0315|consen 19 DHTIRFWQALTGICSRTIQHPDSQVNRLEITPDKKDLAAAGNQHVRLYDLNSNNPNPVATFEGHTK-------------- 84 (311)
T ss_pred cceeeeeehhcCeEEEEEecCccceeeEEEcCCcchhhhccCCeeEEEEccCCCCCceeEEeccCC--------------
Confidence 389999999999999999995 799999996 688999988999999999875 4666666521
Q ss_pred cceee----cCceEEecCCC--ceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCcccccccc
Q 002446 280 GPLAV----GPRWLAYSGSP--VVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQ 353 (921)
Q Consensus 280 ~piAl----gpRwLAyas~~--~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~ 353 (921)
|..++ ..||+..++.+ +.+|..--.+.| +
T Consensus 85 NVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~q---------------------------------------------R 119 (311)
T KOG0315|consen 85 NVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQ---------------------------------------------R 119 (311)
T ss_pred ceEEEEEeecCeEEEecCCCceEEEEeccCcccc---------------------------------------------h
Confidence 22333 34888766543 222211000000 0
Q ss_pred ccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCC
Q 002446 354 YCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQG 432 (921)
Q Consensus 354 y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DG 432 (921)
-+. ....+.....-.. -+++..++..|.|+|||+....+...+- .-..+|.+|...|||++|+.+-..|
T Consensus 120 ~~~-----~~spVn~vvlhpn-----QteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG 189 (311)
T KOG0315|consen 120 NYQ-----HNSPVNTVVLHPN-----QTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKG 189 (311)
T ss_pred hcc-----CCCCcceEEecCC-----cceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCc
Confidence 000 0000000000000 1356678889999999999886655554 4557999999999999999999999
Q ss_pred CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC-CCceeecCCC
Q 002446 433 HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL-GGSVNFQPTD 511 (921)
Q Consensus 433 t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~-g~~~~l~~H~ 511 (921)
+ ..+|++..+... +....+.+++ .+. ..|..+-||||++|||++|.|.|++||.++.+ +....+++|.
T Consensus 190 ~-cyvW~l~~~~~~--------s~l~P~~k~~-ah~-~~il~C~lSPd~k~lat~ssdktv~iwn~~~~~kle~~l~gh~ 258 (311)
T KOG0315|consen 190 N-CYVWRLLNHQTA--------SELEPVHKFQ-AHN-GHILRCLLSPDVKYLATCSSDKTVKIWNTDDFFKLELVLTGHQ 258 (311)
T ss_pred c-EEEEEccCCCcc--------ccceEhhhee-ccc-ceEEEEEECCCCcEEEeecCCceEEEEecCCceeeEEEeecCC
Confidence 8 799999875111 1223333442 222 23899999999999999999999999999988 6667778884
No 30
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.72 E-value=6.5e-15 Score=158.16 Aligned_cols=250 Identities=14% Similarity=0.249 Sum_probs=170.9
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
....|..+.|+. +| .+|+.+. ++.+||||+.+. .+...+....=+|..+++... +.
T Consensus 13 ~~~~i~sl~fs~---~G----~~litss~dDsl~LYd~~~g-~~~~ti~skkyG~~~~~Fth~---------------~~ 69 (311)
T KOG1446|consen 13 TNGKINSLDFSD---DG----LLLITSSEDDSLRLYDSLSG-KQVKTINSKKYGVDLACFTHH---------------SN 69 (311)
T ss_pred CCCceeEEEecC---CC----CEEEEecCCCeEEEEEcCCC-ceeeEeecccccccEEEEecC---------------Cc
Confidence 577899999998 77 4666655 558999999995 444444434344555566531 12
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC---CEEEEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS---RVVAIC 241 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~---riLAVa 241 (921)
-++.+.. . .+.+||.-||.+.++++-+.. ...|.+|+.++ .+|..+
T Consensus 70 ~~i~sSt-k-----------------------------~d~tIryLsl~dNkylRYF~GH~~~V~sL~~sP~~d~FlS~S 119 (311)
T KOG1446|consen 70 TVIHSST-K-----------------------------EDDTIRYLSLHDNKYLRYFPGHKKRVNSLSVSPKDDTFLSSS 119 (311)
T ss_pred eEEEccC-C-----------------------------CCCceEEEEeecCceEEEcCCCCceEEEEEecCCCCeEEecc
Confidence 2223211 0 127899999999999999875 57999999985 567779
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
.|++|++||+++.+|.-.+.... .|+ .||. |+.|
T Consensus 120 ~D~tvrLWDlR~~~cqg~l~~~~---------------~pi------~AfD-------------p~GL------------ 153 (311)
T KOG1446|consen 120 LDKTVRLWDLRVKKCQGLLNLSG---------------RPI------AAFD-------------PEGL------------ 153 (311)
T ss_pred cCCeEEeeEecCCCCceEEecCC---------------Ccc------eeEC-------------CCCc------------
Confidence 99999999999877655443211 122 2454 2210
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC--
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS-- 399 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s-- 399 (921)
+ ++.+.....|++||+++
T Consensus 154 ---i---------------------------------------------------------fA~~~~~~~IkLyD~Rs~d 173 (311)
T KOG1446|consen 154 ---I---------------------------------------------------------FALANGSELIKLYDLRSFD 173 (311)
T ss_pred ---E---------------------------------------------------------EEEecCCCeEEEEEecccC
Confidence 0 01111123799999886
Q ss_pred CceEEEec---cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 400 KNVIAQFR---AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 400 ~~~l~~~~---aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
+.+..+|. +-....+.|.|||||++|+.+...+. +.|.|.-.| ...+-...++....- -.+.+
T Consensus 174 kgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~s~-~~~lDAf~G------------~~~~tfs~~~~~~~~-~~~a~ 239 (311)
T KOG1446|consen 174 KGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNASF-IYLLDAFDG------------TVKSTFSGYPNAGNL-PLSAT 239 (311)
T ss_pred CCCceeEccCCCCccceeeeEEcCCCCEEEEEeCCCc-EEEEEccCC------------cEeeeEeeccCCCCc-ceeEE
Confidence 34555555 34678999999999999998888775 899999887 233333333322111 25789
Q ss_pred EccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 477 FSDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
|+|||+++.+|+.||+||||+++++.....+++
T Consensus 240 ftPds~Fvl~gs~dg~i~vw~~~tg~~v~~~~~ 272 (311)
T KOG1446|consen 240 FTPDSKFVLSGSDDGTIHVWNLETGKKVAVLRG 272 (311)
T ss_pred ECCCCcEEEEecCCCcEEEEEcCCCcEeeEecC
Confidence 999999999999999999999988877777776
No 31
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.72 E-value=3.9e-16 Score=180.93 Aligned_cols=116 Identities=16% Similarity=0.234 Sum_probs=105.8
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
.++++..|.+.+||++...+.+.+|.+|+-.|.|+.|+|..++|||||.|+| |+||.+.+. .++.
T Consensus 477 LiAT~SqDktaKiW~le~~~l~~vLsGH~RGvw~V~Fs~~dq~laT~SgD~T-vKIW~is~f--------------SClk 541 (775)
T KOG0319|consen 477 LIATGSQDKTAKIWDLEQLRLLGVLSGHTRGVWCVSFSKNDQLLATCSGDKT-VKIWSISTF--------------SCLK 541 (775)
T ss_pred eEEecccccceeeecccCceEEEEeeCCccceEEEEeccccceeEeccCCce-EEEEEeccc--------------eeee
Confidence 3567788999999999999999999999999999999999999999999987 999999986 5677
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCc
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANF 514 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~ 514 (921)
+| .||+.+ |..++|-.+++.|.+++.||-++||++.+..+..++..|.+.+
T Consensus 542 T~-eGH~~a-Vlra~F~~~~~qliS~~adGliKlWnikt~eC~~tlD~H~Drv 592 (775)
T KOG0319|consen 542 TF-EGHTSA-VLRASFIRNGKQLISAGADGLIKLWNIKTNECEMTLDAHNDRV 592 (775)
T ss_pred ee-cCccce-eEeeeeeeCCcEEEeccCCCcEEEEeccchhhhhhhhhcccee
Confidence 87 588766 9999999999999999999999999999999999999996544
No 32
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.72 E-value=7.4e-16 Score=181.48 Aligned_cols=242 Identities=17% Similarity=0.217 Sum_probs=184.3
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
..+|.+.|--+.|.. .+ ..|+.|. +..++|||+.+ +++..++..|.+.|+++.+.+.
T Consensus 245 l~GH~g~V~~l~~~~---~~----~~lvsgS~D~t~rvWd~~s-g~C~~~l~gh~stv~~~~~~~~-------------- 302 (537)
T KOG0274|consen 245 LVGHFGGVWGLAFPS---GG----DKLVSGSTDKTERVWDCST-GECTHSLQGHTSSVRCLTIDPF-------------- 302 (537)
T ss_pred ccCCCCCceeEEEec---CC----CEEEEEecCCcEEeEecCC-CcEEEEecCCCceEEEEEccCc--------------
Confidence 678999999888887 22 3666666 88899999888 7888889999999999987642
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcCCEEEE-
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSSRVVAI- 240 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~riLAV- 240 (921)
++ ++++ -+++|++|++.++.+++++. +..+|++|.++..+|+.
T Consensus 303 --~~--~sgs-------------------------------~D~tVkVW~v~n~~~l~l~~~h~~~V~~v~~~~~~lvsg 347 (537)
T KOG0274|consen 303 --LL--VSGS-------------------------------RDNTVKVWDVTNGACLNLLRGHTGPVNCVQLDEPLLVSG 347 (537)
T ss_pred --eE--eecc-------------------------------CCceEEEEeccCcceEEEeccccccEEEEEecCCEEEEE
Confidence 11 2221 13899999999999999999 88999999999766554
Q ss_pred EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 241 CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 241 a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
+++++|.+||+.++++++++..|... + .-|++...
T Consensus 348 s~d~~v~VW~~~~~~cl~sl~gH~~~---------------V----~sl~~~~~-------------------------- 382 (537)
T KOG0274|consen 348 SYDGTVKVWDPRTGKCLKSLSGHTGR---------------V----YSLIVDSE-------------------------- 382 (537)
T ss_pred ecCceEEEEEhhhceeeeeecCCcce---------------E----EEEEecCc--------------------------
Confidence 88999999999999999999876321 1 01111100
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
+ ...++..|+.|++||+.++
T Consensus 383 -------------~-----------------------------------------------~~~Sgs~D~~IkvWdl~~~ 402 (537)
T KOG0274|consen 383 -------------N-----------------------------------------------RLLSGSLDTTIKVWDLRTK 402 (537)
T ss_pred -------------c-----------------------------------------------eEEeeeeccceEeecCCch
Confidence 0 0112344688999999999
Q ss_pred -ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc
Q 002446 401 -NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD 479 (921)
Q Consensus 401 -~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP 479 (921)
+++.+++.|.+-+..+. ..+++|++++.||+ |++||+.++ .++..+.-. +...|..+++.
T Consensus 403 ~~c~~tl~~h~~~v~~l~--~~~~~Lvs~~aD~~-Ik~WD~~~~--------------~~~~~~~~~-~~~~v~~l~~~- 463 (537)
T KOG0274|consen 403 RKCIHTLQGHTSLVSSLL--LRDNFLVSSSADGT-IKLWDAEEG--------------ECLRTLEGR-HVGGVSALALG- 463 (537)
T ss_pred hhhhhhhcCCcccccccc--cccceeEecccccc-EEEeecccC--------------ceeeeeccC-CcccEEEeecC-
Confidence 99999999999886554 46799999999997 999999986 344555322 22348888877
Q ss_pred CCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 480 DSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
...+++++.||++++||+........+
T Consensus 464 -~~~il~s~~~~~~~l~dl~~~~~~~~l 490 (537)
T KOG0274|consen 464 -KEEILCSSDDGSVKLWDLRSGTLIRTL 490 (537)
T ss_pred -cceEEEEecCCeeEEEecccCchhhhh
Confidence 567889999999999999987665554
No 33
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.71 E-value=4.7e-17 Score=178.53 Aligned_cols=251 Identities=17% Similarity=0.300 Sum_probs=177.8
Q ss_pred CCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEE
Q 002446 88 HDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLV 167 (921)
Q Consensus 88 kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLA 167 (921)
|-.|.-++|-. +| |++|...+.+.|-+|+.... +++.++..||.+||+++++++- .-+
T Consensus 96 kc~V~~v~WtP---eG---RRLltgs~SGEFtLWNg~~f-nFEtilQaHDs~Vr~m~ws~~g---------------~wm 153 (464)
T KOG0284|consen 96 KCPVNVVRWTP---EG---RRLLTGSQSGEFTLWNGTSF-NFETILQAHDSPVRTMKWSHNG---------------TWM 153 (464)
T ss_pred ccceeeEEEcC---CC---ceeEeecccccEEEecCcee-eHHHHhhhhcccceeEEEccCC---------------CEE
Confidence 44555555555 44 66666666667999999763 5666778999999999998741 223
Q ss_pred EEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-C-CCCEEEEEEcC---CEEEEEe
Q 002446 168 FCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-F-RSPIYSVRCSS---RVVAICQ 242 (921)
Q Consensus 168 vv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f-~s~V~sV~~S~---riLAVa~ 242 (921)
+.++. .++|++|+..-.. |+.++ + ...|+.++|++ +++..+.
T Consensus 154 iSgD~--------------------------------gG~iKyWqpnmnn-Vk~~~ahh~eaIRdlafSpnDskF~t~Sd 200 (464)
T KOG0284|consen 154 ISGDK--------------------------------GGMIKYWQPNMNN-VKIIQAHHAEAIRDLAFSPNDSKFLTCSD 200 (464)
T ss_pred EEcCC--------------------------------CceEEecccchhh-hHHhhHhhhhhhheeccCCCCceeEEecC
Confidence 33321 1789999986544 44444 3 37999999983 6777788
Q ss_pred CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCC
Q 002446 243 AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNG 322 (921)
Q Consensus 243 d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g 322 (921)
|++|+|||....+....|.+| ++.+ +.++.. |+
T Consensus 201 Dg~ikiWdf~~~kee~vL~GH--------------gwdV-----ksvdWH-------------P~--------------- 233 (464)
T KOG0284|consen 201 DGTIKIWDFRMPKEERVLRGH--------------GWDV-----KSVDWH-------------PT--------------- 233 (464)
T ss_pred CCeEEEEeccCCchhheeccC--------------CCCc-----ceeccC-------------Cc---------------
Confidence 999999999988776666554 1111 111111 11
Q ss_pred cceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCce
Q 002446 323 SRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNV 402 (921)
Q Consensus 323 ~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~ 402 (921)
| +.+++++.|..|++||..++++
T Consensus 234 -----------k----------------------------------------------gLiasgskDnlVKlWDprSg~c 256 (464)
T KOG0284|consen 234 -----------K----------------------------------------------GLIASGSKDNLVKLWDPRSGSC 256 (464)
T ss_pred -----------c----------------------------------------------ceeEEccCCceeEeecCCCcch
Confidence 0 1123344556899999999999
Q ss_pred EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc-CC
Q 002446 403 IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD-DS 481 (921)
Q Consensus 403 l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP-Dg 481 (921)
++++.+|+..|..+.|+|+|.+|+|+|.|. .+++||+.+- ..+..+ |||.. .|.+++|+| .-
T Consensus 257 l~tlh~HKntVl~~~f~~n~N~Llt~skD~-~~kv~DiR~m--------------kEl~~~-r~Hkk-dv~~~~WhP~~~ 319 (464)
T KOG0284|consen 257 LATLHGHKNTVLAVKFNPNGNWLLTGSKDQ-SCKVFDIRTM--------------KELFTY-RGHKK-DVTSLTWHPLNE 319 (464)
T ss_pred hhhhhhccceEEEEEEcCCCCeeEEccCCc-eEEEEehhHh--------------HHHHHh-hcchh-hheeeccccccc
Confidence 999999999999999999999999999996 5999999853 233444 66653 499999999 56
Q ss_pred CEEEEEeCCCcEEEEecCCCCCceee-cCCCCCc
Q 002446 482 NWIMISSSRGTSHLFAINPLGGSVNF-QPTDANF 514 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWdi~~~g~~~~l-~~H~~~~ 514 (921)
.+|.+|+.||.|..|.+........+ .+|...+
T Consensus 320 ~lftsgg~Dgsvvh~~v~~~~p~~~i~~AHd~~i 353 (464)
T KOG0284|consen 320 SLFTSGGSDGSVVHWVVGLEEPLGEIPPAHDGEI 353 (464)
T ss_pred cceeeccCCCceEEEeccccccccCCCcccccce
Confidence 78899999999999998743333333 4554333
No 34
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.71 E-value=7.1e-17 Score=175.09 Aligned_cols=282 Identities=16% Similarity=0.226 Sum_probs=185.7
Q ss_pred hccccccCCCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCcc
Q 002446 75 VASSIVERDDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKR 154 (921)
Q Consensus 75 ~~~s~~~~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~ 154 (921)
||-.-+ ...++|+|.|....=++ .-...|+..++++.++|||+.. -++...+..|+|.|+-+.+-..
T Consensus 54 fakPFv-~~L~gHrdGV~~lakhp-----~~ls~~aSGs~DG~VkiWnlsq-R~~~~~f~AH~G~V~Gi~v~~~------ 120 (433)
T KOG0268|consen 54 FAKPFV-GSLDGHRDGVSCLAKHP-----NKLSTVASGSCDGEVKIWNLSQ-RECIRTFKAHEGLVRGICVTQT------ 120 (433)
T ss_pred hhccch-hhccccccccchhhcCc-----chhhhhhccccCceEEEEehhh-hhhhheeecccCceeeEEeccc------
Confidence 344433 23478999998876655 1123566667788899999998 4666778889999998877421
Q ss_pred ccCccccCCCEEEEEeCCCCcCCccccCC-cccccCCC---CCCcCCCCCCCCCC--cEEEEEECCCCcEEEEEeCC-CC
Q 002446 155 SRDKFAEVRPLLVFCADGSRSCGTKVQDG-LATACNGT---SANYHDLGNGSSVP--TVVHFYSLRSQSYVHMLKFR-SP 227 (921)
Q Consensus 155 ~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg-~~~~~~g~---~~~~h~~g~~~~~~--~tVrIWDL~Tg~~V~tL~f~-s~ 227 (921)
..+ .|+++.. .-.-.-+| ....+.|. .+-.|.-.+..+.. ..|.|||..-...+.+++.. ..
T Consensus 121 ---------~~~-tvgdDKt-vK~wk~~~~p~~tilg~s~~~gIdh~~~~~~FaTcGe~i~IWD~~R~~Pv~smswG~Dt 189 (433)
T KOG0268|consen 121 ---------SFF-TVGDDKT-VKQWKIDGPPLHTILGKSVYLGIDHHRKNSVFATCGEQIDIWDEQRDNPVSSMSWGADS 189 (433)
T ss_pred ---------ceE-EecCCcc-eeeeeccCCcceeeeccccccccccccccccccccCceeeecccccCCccceeecCCCc
Confidence 112 2222210 00000000 00000000 00011111112222 34899999999999999875 57
Q ss_pred EEEEEEcC---CEEEEE-eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCc
Q 002446 228 IYSVRCSS---RVVAIC-QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGR 303 (921)
Q Consensus 228 V~sV~~S~---riLAVa-~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~Gr 303 (921)
|.+|+||+ .+|+++ .|+.|.+||+++...++.+...- -+|.|+.+| =||
T Consensus 190 i~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~~m-------------RTN~IswnP--eaf------------ 242 (433)
T KOG0268|consen 190 ISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVILTM-------------RTNTICWNP--EAF------------ 242 (433)
T ss_pred eeEEecCCCcchheeeeccCCceEEEecccCCccceeeeec-------------cccceecCc--ccc------------
Confidence 89999984 788885 88999999999988777654321 122232211 000
Q ss_pred cCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcc
Q 002446 304 VNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHF 383 (921)
Q Consensus 304 vsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~ 383 (921)
.|
T Consensus 243 ------------------------------------------------------------------------------nF 244 (433)
T KOG0268|consen 243 ------------------------------------------------------------------------------NF 244 (433)
T ss_pred ------------------------------------------------------------------------------ce
Confidence 12
Q ss_pred cccCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 384 PDADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+.++.|..+..||+... +++...++|.++|..+.|||.|+-+++||.|.+ ||||.+..+ .-+.+|-
T Consensus 245 ~~a~ED~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~EfvsgsyDks-IRIf~~~~~------------~SRdiYh 311 (433)
T KOG0268|consen 245 VAANEDHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVSGSYDKS-IRIFPVNHG------------HSRDIYH 311 (433)
T ss_pred eeccccccceehhhhhhcccchhhcccceeEEEeccCCCcchhccccccce-EEEeecCCC------------cchhhhh
Confidence 33456677888888764 577888999999999999999999999999976 999999875 1133444
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.+|- ..|.++.||.|++|+.+||+|+.|++|.-...
T Consensus 312 tkRM---q~V~~Vk~S~Dskyi~SGSdd~nvRlWka~As 347 (433)
T KOG0268|consen 312 TKRM---QHVFCVKYSMDSKYIISGSDDGNVRLWKAKAS 347 (433)
T ss_pred Hhhh---heeeEEEEeccccEEEecCCCcceeeeecchh
Confidence 4442 34999999999999999999999999987654
No 35
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.71 E-value=1.2e-15 Score=174.02 Aligned_cols=190 Identities=13% Similarity=0.234 Sum_probs=153.2
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
+.|.|||..|...|++++. .-||++-+|= ++.+++ +.|.+|+||+..|+++.++++.|++.-
T Consensus 35 G~V~IWnyetqtmVksfeV~~~PvRa~kfiaRknWiv~GsDD~~IrVfnynt~ekV~~FeAH~DyI-------------- 100 (794)
T KOG0276|consen 35 GDVQIWNYETQTMVKSFEVSEVPVRAAKFIARKNWIVTGSDDMQIRVFNYNTGEKVKTFEAHSDYI-------------- 100 (794)
T ss_pred CeeEEEecccceeeeeeeecccchhhheeeeccceEEEecCCceEEEEecccceeeEEeeccccce--------------
Confidence 5699999999999999987 5699988884 567777 666799999999999999999986521
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
|.||.. |+ + .|
T Consensus 101 -----R~iavH-------------Pt-~-------------------------------------------P~------- 111 (794)
T KOG0276|consen 101 -----RSIAVH-------------PT-L-------------------------------------------PY------- 111 (794)
T ss_pred -----eeeeec-------------CC-C-------------------------------------------Ce-------
Confidence 333432 22 0 00
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEe
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFK 439 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWd 439 (921)
+.++..|-+|++||.+.+ .+..+|.+|++-|.+++|+| |-..+|+||-|+| |+||.
T Consensus 112 ---------------------vLtsSDDm~iKlW~we~~wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~sLDrT-VKVWs 169 (794)
T KOG0276|consen 112 ---------------------VLTSSDDMTIKLWDWENEWACEQTFEGHEHYVMQVAFNPKDPNTFASASLDRT-VKVWS 169 (794)
T ss_pred ---------------------EEecCCccEEEEeeccCceeeeeEEcCcceEEEEEEecCCCccceeeeecccc-EEEEE
Confidence 122345678999999876 67889999999999999999 6779999999998 99999
Q ss_pred CCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc--CCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCccc
Q 002446 440 IIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD--DSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFTT 516 (921)
Q Consensus 440 i~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP--Dg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~~ 516 (921)
+... ...++|. ||... |+||.|=+ |-.||.+|++|.|++|||..+..+..++.+|+.++.-
T Consensus 170 lgs~--------------~~nfTl~-gHekG-VN~Vdyy~~gdkpylIsgaDD~tiKvWDyQtk~CV~TLeGHt~Nvs~ 232 (794)
T KOG0276|consen 170 LGSP--------------HPNFTLE-GHEKG-VNCVDYYTGGDKPYLISGADDLTIKVWDYQTKSCVQTLEGHTNNVSF 232 (794)
T ss_pred cCCC--------------CCceeee-ccccC-cceEEeccCCCcceEEecCCCceEEEeecchHHHHHHhhcccccceE
Confidence 8764 3456775 76654 99999965 5579999999999999999999999999999888763
No 36
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.70 E-value=2.2e-15 Score=158.52 Aligned_cols=262 Identities=16% Similarity=0.186 Sum_probs=173.0
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
.+|.-.++.++||+ +|+ .++.++-+...-||-..+ |+..-.+..|.|.|.|+.+--. ++-
T Consensus 7 ~GHERplTqiKyN~---eGD---LlFscaKD~~~~vw~s~n-GerlGty~GHtGavW~~Did~~-------------s~~ 66 (327)
T KOG0643|consen 7 QGHERPLTQIKYNR---EGD---LLFSCAKDSTPTVWYSLN-GERLGTYDGHTGAVWCCDIDWD-------------SKH 66 (327)
T ss_pred ccCccccceEEecC---CCc---EEEEecCCCCceEEEecC-CceeeeecCCCceEEEEEecCC-------------cce
Confidence 46777899999999 774 667777778889999877 5666667789999999987421 111
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEe
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQ 242 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~ 242 (921)
| +.+. .+.+++|||.++|+++.+++++++|..+.|+ +.+++++.
T Consensus 67 l---iTGS-------------------------------AD~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~t 112 (327)
T KOG0643|consen 67 L---ITGS-------------------------------ADQTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILAST 112 (327)
T ss_pred e---eecc-------------------------------ccceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEe
Confidence 2 2221 1278999999999999999999999999997 56666655
Q ss_pred C------CEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccc
Q 002446 243 A------AQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFS 316 (921)
Q Consensus 243 d------~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~ 316 (921)
+ ..|.+||++..... +.. -.|+ +.... |+
T Consensus 113 D~~mg~~~~v~~fdi~~~~~~--~~s----------------~ep~------~kI~t------------~~--------- 147 (327)
T KOG0643|consen 113 DKQMGYTCFVSVFDIRDDSSD--IDS----------------EEPY------LKIPT------------PD--------- 147 (327)
T ss_pred hhhcCcceEEEEEEccCChhh--hcc----------------cCce------EEecC------------Cc---------
Confidence 4 37888888743210 000 0000 00000 00
Q ss_pred cccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEE
Q 002446 317 GFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRD 396 (921)
Q Consensus 317 ~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwD 396 (921)
+|-..+++-.++ ..++.+..+|.|.+||
T Consensus 148 ----------------skit~a~Wg~l~------------------------------------~~ii~Ghe~G~is~~d 175 (327)
T KOG0643|consen 148 ----------------SKITSALWGPLG------------------------------------ETIIAGHEDGSISIYD 175 (327)
T ss_pred ----------------cceeeeeecccC------------------------------------CEEEEecCCCcEEEEE
Confidence 000000000011 1234567889999999
Q ss_pred CCCC-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCC---------CCCCCccCC---------CCce
Q 002446 397 IVSK-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGI---------LGTSSACDA---------GTSY 457 (921)
Q Consensus 397 l~s~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~---------~~~~s~~~~---------~~~~ 457 (921)
+.++ +.+...+.|.+.|+.|+|+||.++++|+|.|.+ -++||..+-. +-+..+..+ ....
T Consensus 176 a~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~Dtt-akl~D~~tl~v~Kty~te~PvN~aaisP~~d~VilgGGqeA 254 (327)
T KOG0643|consen 176 ARTGKELVDSDEEHSSKINDLQFSRDRTYFITGSKDTT-AKLVDVRTLEVLKTYTTERPVNTAAISPLLDHVILGGGQEA 254 (327)
T ss_pred cccCceeeechhhhccccccccccCCcceEEecccCcc-ceeeeccceeeEEEeeecccccceecccccceEEecCCcee
Confidence 9997 556677899999999999999999999999976 7999987631 101000000 0000
Q ss_pred eE-----------------------EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 458 VH-----------------------LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 458 ~~-----------------------l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.. +-++ .||- ..|++|||+|||+-.++|+.||.|+|.....
T Consensus 255 ~dVTTT~~r~GKFEArFyh~i~eEEigrv-kGHF-GPINsvAfhPdGksYsSGGEDG~VR~h~Fd~ 318 (327)
T KOG0643|consen 255 MDVTTTSTRAGKFEARFYHLIFEEEIGRV-KGHF-GPINSVAFHPDGKSYSSGGEDGYVRLHHFDS 318 (327)
T ss_pred eeeeeecccccchhhhHHHHHHHHHhccc-cccc-cCcceeEECCCCcccccCCCCceEEEEEecc
Confidence 00 0011 2332 3599999999999999999999999876543
No 37
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.70 E-value=5.2e-15 Score=157.32 Aligned_cols=235 Identities=14% Similarity=0.194 Sum_probs=176.5
Q ss_pred CCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCC--C---CeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 88 HDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEA--D---NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 88 kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~--~---~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
.-.|.-+.|-+ .+ .-|-..|.+|-.-||++... . .+...+..|.|=++|++|+++-
T Consensus 97 s~WVMtCA~sP---Sg---~~VAcGGLdN~Csiy~ls~~d~~g~~~v~r~l~gHtgylScC~f~dD~------------- 157 (343)
T KOG0286|consen 97 SSWVMTCAYSP---SG---NFVACGGLDNKCSIYPLSTRDAEGNVRVSRELAGHTGYLSCCRFLDDN------------- 157 (343)
T ss_pred ceeEEEEEECC---CC---CeEEecCcCceeEEEecccccccccceeeeeecCccceeEEEEEcCCC-------------
Confidence 45566777776 55 24445556888899999853 2 2344567789999999998641
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC---CEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS---RVV 238 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~---riL 238 (921)
.||. +.| | .|.-+||+++|+.+..+.- ..-|.++.+++ +.+
T Consensus 158 -~ilT--~SG---------D-----------------------~TCalWDie~g~~~~~f~GH~gDV~slsl~p~~~ntF 202 (343)
T KOG0286|consen 158 -HILT--GSG---------D-----------------------MTCALWDIETGQQTQVFHGHTGDVMSLSLSPSDGNTF 202 (343)
T ss_pred -ceEe--cCC---------C-----------------------ceEEEEEcccceEEEEecCCcccEEEEecCCCCCCeE
Confidence 2331 111 1 6789999999999999875 56899999964 555
Q ss_pred EE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccc
Q 002446 239 AI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSG 317 (921)
Q Consensus 239 AV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~ 317 (921)
+. +-|+..++||++.+.+.+++.+|.. ..|.+. |-
T Consensus 203 vSg~cD~~aklWD~R~~~c~qtF~ghes------------DINsv~-------ff------------------------- 238 (343)
T KOG0286|consen 203 VSGGCDKSAKLWDVRSGQCVQTFEGHES------------DINSVR-------FF------------------------- 238 (343)
T ss_pred EecccccceeeeeccCcceeEeeccccc------------ccceEE-------Ec-------------------------
Confidence 55 7789999999999999999887732 122222 11
Q ss_pred ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEEC
Q 002446 318 FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDI 397 (921)
Q Consensus 318 ~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl 397 (921)
|++. .|+++..+++.++||+
T Consensus 239 ------------------------------------------P~G~------------------afatGSDD~tcRlyDl 258 (343)
T KOG0286|consen 239 ------------------------------------------PSGD------------------AFATGSDDATCRLYDL 258 (343)
T ss_pred ------------------------------------------cCCC------------------eeeecCCCceeEEEee
Confidence 1110 1345677899999999
Q ss_pred CCCceEEEeccC--CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEE
Q 002446 398 VSKNVIAQFRAH--KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDI 475 (921)
Q Consensus 398 ~s~~~l~~~~aH--~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sI 475 (921)
...+.++.+... ..+|++++||-+|++|..+-.|.+ ++|||...+ ..+-.| .||. .+|.+|
T Consensus 259 RaD~~~a~ys~~~~~~gitSv~FS~SGRlLfagy~d~~-c~vWDtlk~--------------e~vg~L-~GHe-NRvScl 321 (343)
T KOG0286|consen 259 RADQELAVYSHDSIICGITSVAFSKSGRLLFAGYDDFT-CNVWDTLKG--------------ERVGVL-AGHE-NRVSCL 321 (343)
T ss_pred cCCcEEeeeccCcccCCceeEEEcccccEEEeeecCCc-eeEeecccc--------------ceEEEe-eccC-CeeEEE
Confidence 999999988833 369999999999999999999987 899999986 344455 3654 469999
Q ss_pred EEccCCCEEEEEeCCCcEEEEe
Q 002446 476 SFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 476 aFSPDg~~LAsgS~DgTVhVWd 497 (921)
..+|||.-|++||-|.+++||.
T Consensus 322 ~~s~DG~av~TgSWDs~lriW~ 343 (343)
T KOG0286|consen 322 GVSPDGMAVATGSWDSTLRIWA 343 (343)
T ss_pred EECCCCcEEEecchhHheeecC
Confidence 9999999999999999999994
No 38
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.69 E-value=1.2e-15 Score=165.30 Aligned_cols=240 Identities=18% Similarity=0.262 Sum_probs=188.7
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEccC-cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGYRS-GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~-GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
..+|-..|..+.||. .+ ..|+.|..+ .++|||+++ +.++-.+-.|-..||-+++++.
T Consensus 147 i~gHlgWVr~vavdP---~n----~wf~tgs~DrtikIwDlat-g~LkltltGhi~~vr~vavS~r-------------- 204 (460)
T KOG0285|consen 147 ISGHLGWVRSVAVDP---GN----EWFATGSADRTIKIWDLAT-GQLKLTLTGHIETVRGVAVSKR-------------- 204 (460)
T ss_pred hhhccceEEEEeeCC---Cc----eeEEecCCCceeEEEEccc-CeEEEeecchhheeeeeeeccc--------------
Confidence 346788899999998 33 788888855 589999998 6787778889999999999864
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcC--CEEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSS--RVVA 239 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~--riLA 239 (921)
+|+|..|+.+ +.|+-|||...+.|+... +-+.|+.++.-+ ++|+
T Consensus 205 HpYlFs~ged---------------------------------k~VKCwDLe~nkvIR~YhGHlS~V~~L~lhPTldvl~ 251 (460)
T KOG0285|consen 205 HPYLFSAGED---------------------------------KQVKCWDLEYNKVIRHYHGHLSGVYCLDLHPTLDVLV 251 (460)
T ss_pred CceEEEecCC---------------------------------CeeEEEechhhhhHHHhccccceeEEEeccccceeEE
Confidence 5888777652 679999999999988765 358999999963 5666
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
. +.|.+|++||++|...++++.+|.+ +++ +-++-+.
T Consensus 252 t~grDst~RvWDiRtr~~V~~l~GH~~---------------~V~---~V~~~~~------------------------- 288 (460)
T KOG0285|consen 252 TGGRDSTIRVWDIRTRASVHVLSGHTN---------------PVA---SVMCQPT------------------------- 288 (460)
T ss_pred ecCCcceEEEeeecccceEEEecCCCC---------------cce---eEEeecC-------------------------
Confidence 5 6788999999999999999988743 222 0000000
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
++.+.++..|++|++||+.
T Consensus 289 -------------------------------------------------------------dpqvit~S~D~tvrlWDl~ 307 (460)
T KOG0285|consen 289 -------------------------------------------------------------DPQVITGSHDSTVRLWDLR 307 (460)
T ss_pred -------------------------------------------------------------CCceEEecCCceEEEeeec
Confidence 0012345678999999999
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
.++...++..|+..|.||+.+|.-.++|+||.| .|+-|++..+ ..+..+ .|+ ++.|.+++..
T Consensus 308 agkt~~tlt~hkksvral~lhP~e~~fASas~d--nik~w~~p~g--------------~f~~nl-sgh-~~iintl~~n 369 (460)
T KOG0285|consen 308 AGKTMITLTHHKKSVRALCLHPKENLFASASPD--NIKQWKLPEG--------------EFLQNL-SGH-NAIINTLSVN 369 (460)
T ss_pred cCceeEeeecccceeeEEecCCchhhhhccCCc--cceeccCCcc--------------chhhcc-ccc-cceeeeeeec
Confidence 999999999999999999999999999999999 4899999886 223343 344 3569999998
Q ss_pred cCCCEEEEEeCCCcEEEEecCCC
Q 002446 479 DDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.|+ ++++|++.|++..||-.++
T Consensus 370 sD~-v~~~G~dng~~~fwdwksg 391 (460)
T KOG0285|consen 370 SDG-VLVSGGDNGSIMFWDWKSG 391 (460)
T ss_pred cCc-eEEEcCCceEEEEEecCcC
Confidence 887 5668999999999999875
No 39
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.69 E-value=1.7e-15 Score=175.78 Aligned_cols=233 Identities=17% Similarity=0.232 Sum_probs=158.8
Q ss_pred cEEEEEECCCCcEEEEEe-CCCCEEEEEEcC---CEEEEE-eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccc
Q 002446 206 TVVHFYSLRSQSYVHMLK-FRSPIYSVRCSS---RVVAIC-QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYG 280 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~---riLAVa-~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~ 280 (921)
..+.|||.++.+.++.|- +...|++++|-+ ++|||+ ....+++||+.|+.|. .+.+|....-. + .
T Consensus 303 Qnl~l~d~~~l~i~k~ivG~ndEI~Dm~~lG~e~~~laVATNs~~lr~y~~~~~~c~-ii~GH~e~vlS-------L--~ 372 (775)
T KOG0319|consen 303 QNLFLYDEDELTIVKQIVGYNDEILDMKFLGPEESHLAVATNSPELRLYTLPTSYCQ-IIPGHTEAVLS-------L--D 372 (775)
T ss_pred ceEEEEEccccEEehhhcCCchhheeeeecCCccceEEEEeCCCceEEEecCCCceE-EEeCchhheee-------e--e
Confidence 458899999999988774 688999999964 889985 4569999999999876 56666432100 0 0
Q ss_pred ceeecCceEEecCCC--ceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccc
Q 002446 281 PLAVGPRWLAYSGSP--VVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEF 358 (921)
Q Consensus 281 piAlgpRwLAyas~~--~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~ 358 (921)
++-+.-|||..+++ +++|-. ..+ -.....+|.-. |+.
T Consensus 373 -~~~~g~llat~sKD~svilWr~--------~~~---------~~~~~~~a~~~-----------gH~------------ 411 (775)
T KOG0319|consen 373 -VWSSGDLLATGSKDKSVILWRL--------NNN---------CSKSLCVAQAN-----------GHT------------ 411 (775)
T ss_pred -ecccCcEEEEecCCceEEEEEe--------cCC---------cchhhhhhhhc-----------ccc------------
Confidence 11223477766543 444411 000 00000011000 000
Q ss_pred cCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc-----eEE----EeccCCCCeEEEEECCCCCEEEEEe
Q 002446 359 LPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN-----VIA----QFRAHKSPISALCFDPSGILLVTAS 429 (921)
Q Consensus 359 ~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~-----~l~----~~~aH~~pIsaLaFSPdGtlLATaS 429 (921)
+++. +-...+ .+ ..-|++.+.|+++++|++...+ .+. +..+|...|+|++.+|+.+++||||
T Consensus 412 -----~svg-ava~~~-~~--asffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~S 482 (775)
T KOG0319|consen 412 -----NSVG-AVAGSK-LG--ASFFVSVSQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGS 482 (775)
T ss_pred -----cccc-eeeecc-cC--ccEEEEecCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecc
Confidence 0000 000000 00 0134677889999999997621 111 3459999999999999999999999
Q ss_pred cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 430 VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 430 ~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
.|.+ .+||++... .++..| +||+.. |+|+.|||..+.+|++|.|+||+||.|+++.+..+|.|
T Consensus 483 qDkt-aKiW~le~~--------------~l~~vL-sGH~RG-vw~V~Fs~~dq~laT~SgD~TvKIW~is~fSClkT~eG 545 (775)
T KOG0319|consen 483 QDKT-AKIWDLEQL--------------RLLGVL-SGHTRG-VWCVSFSKNDQLLATCSGDKTVKIWSISTFSCLKTFEG 545 (775)
T ss_pred cccc-eeeecccCc--------------eEEEEe-eCCccc-eEEEEeccccceeEeccCCceEEEEEeccceeeeeecC
Confidence 9987 899999853 566666 577654 99999999999999999999999999999999999999
Q ss_pred CCCCcc
Q 002446 510 TDANFT 515 (921)
Q Consensus 510 H~~~~~ 515 (921)
|...+-
T Consensus 546 H~~aVl 551 (775)
T KOG0319|consen 546 HTSAVL 551 (775)
T ss_pred ccceeE
Confidence 965544
No 40
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.69 E-value=1.6e-15 Score=178.75 Aligned_cols=230 Identities=14% Similarity=0.148 Sum_probs=170.8
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEe-eeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDL-VSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~el-vS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
.++...++..+++||+.+ +.+... +..|.|.|+.++|.. ..++|..+.. |
T Consensus 220 ~~~~~s~~~tl~~~~~~~-~~~i~~~l~GH~g~V~~l~~~~--------------~~~~lvsgS~----------D---- 270 (537)
T KOG0274|consen 220 FFKSGSDDSTLHLWDLNN-GYLILTRLVGHFGGVWGLAFPS--------------GGDKLVSGST----------D---- 270 (537)
T ss_pred eEEecCCCceeEEeeccc-ceEEEeeccCCCCCceeEEEec--------------CCCEEEEEec----------C----
Confidence 344444455678999998 444444 778999999999852 1134432221 2
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcCCEEEE-EeCCEEEEEECCCCcEEEEEecCC
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSSRVVAI-CQAAQVHCFDAATLEIEYAILTNP 264 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p 264 (921)
.++|+||+.+|+|+++|.. .+.|+.+..-+.+++. +.|.+|++||+.++.+++++..|.
T Consensus 271 -------------------~t~rvWd~~sg~C~~~l~gh~stv~~~~~~~~~~~sgs~D~tVkVW~v~n~~~l~l~~~h~ 331 (537)
T KOG0274|consen 271 -------------------KTERVWDCSTGECTHSLQGHTSSVRCLTIDPFLLVSGSRDNTVKVWDVTNGACLNLLRGHT 331 (537)
T ss_pred -------------------CcEEeEecCCCcEEEEecCCCceEEEEEccCceEeeccCCceEEEEeccCcceEEEecccc
Confidence 7899999999999999994 6777777776655555 689999999999999998887642
Q ss_pred CccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecC
Q 002446 265 IVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLG 344 (921)
Q Consensus 265 ~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lG 344 (921)
. +| +-+.+. +
T Consensus 332 ~---------------~V----~~v~~~-----------------------------~---------------------- 341 (537)
T KOG0274|consen 332 G---------------PV----NCVQLD-----------------------------E---------------------- 341 (537)
T ss_pred c---------------cE----EEEEec-----------------------------C----------------------
Confidence 1 11 111111 0
Q ss_pred CccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCE
Q 002446 345 DLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGIL 424 (921)
Q Consensus 345 d~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtl 424 (921)
..++++..+|+|+|||+.++++++++++|+..|.++.|++. ..
T Consensus 342 ------------------------------------~~lvsgs~d~~v~VW~~~~~~cl~sl~gH~~~V~sl~~~~~-~~ 384 (537)
T KOG0274|consen 342 ------------------------------------PLLVSGSYDGTVKVWDPRTGKCLKSLSGHTGRVYSLIVDSE-NR 384 (537)
T ss_pred ------------------------------------CEEEEEecCceEEEEEhhhceeeeeecCCcceEEEEEecCc-ce
Confidence 01223466789999999999999999999999999999887 89
Q ss_pred EEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 425 LVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 425 LATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
+.++|.|++ |++||+.+. ..+++.| .|++ +.+.++ ...+++|.+++.|++|++||++.++..
T Consensus 385 ~~Sgs~D~~-IkvWdl~~~-------------~~c~~tl-~~h~-~~v~~l--~~~~~~Lvs~~aD~~Ik~WD~~~~~~~ 446 (537)
T KOG0274|consen 385 LLSGSLDTT-IKVWDLRTK-------------RKCIHTL-QGHT-SLVSSL--LLRDNFLVSSSADGTIKLWDAEEGECL 446 (537)
T ss_pred EEeeeeccc-eEeecCCch-------------hhhhhhh-cCCc-cccccc--ccccceeEeccccccEEEeecccCcee
Confidence 999999976 999999874 0345555 3443 335444 456899999999999999999999998
Q ss_pred eeecCC
Q 002446 505 VNFQPT 510 (921)
Q Consensus 505 ~~l~~H 510 (921)
..+.++
T Consensus 447 ~~~~~~ 452 (537)
T KOG0274|consen 447 RTLEGR 452 (537)
T ss_pred eeeccC
Confidence 888873
No 41
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.69 E-value=1e-14 Score=154.34 Aligned_cols=224 Identities=13% Similarity=0.232 Sum_probs=158.1
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
-.|..+.+..+++||++. ++....+-.|..-|-+++|.|+ .|.+ |+++
T Consensus 77 ~alS~swD~~lrlWDl~~-g~~t~~f~GH~~dVlsva~s~d-------------n~qi---vSGS--------------- 124 (315)
T KOG0279|consen 77 FALSASWDGTLRLWDLAT-GESTRRFVGHTKDVLSVAFSTD-------------NRQI---VSGS--------------- 124 (315)
T ss_pred eEEeccccceEEEEEecC-CcEEEEEEecCCceEEEEecCC-------------Ccee---ecCC---------------
Confidence 555666677799999998 5677777789889999999874 1222 3321
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC--CCCEEEEEEcCC----EEEE-EeCCEEEEEECCCCcEEEEE
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF--RSPIYSVRCSSR----VVAI-CQAAQVHCFDAATLEIEYAI 260 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f--~s~V~sV~~S~r----iLAV-a~d~~I~IwDl~T~~~l~tL 260 (921)
-++|+++|+...+.......- +..|..|+|+++ +|+. +.|++|++||+.+.+..+++
T Consensus 125 ----------------rDkTiklwnt~g~ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~~l~~~~ 188 (315)
T KOG0279|consen 125 ----------------RDKTIKLWNTLGVCKYTIHEDSHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNCQLRTTF 188 (315)
T ss_pred ----------------CcceeeeeeecccEEEEEecCCCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCcchhhcc
Confidence 228999999987765555544 679999999754 4444 67899999999999877766
Q ss_pred ecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhccee
Q 002446 261 LTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGI 340 (921)
Q Consensus 261 ~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl 340 (921)
.+|.. + .+.+++ + |+ |.
T Consensus 189 ~gh~~---~---------v~t~~v-------S-------------pD--------------Gs----------------- 205 (315)
T KOG0279|consen 189 IGHSG---Y---------VNTVTV-------S-------------PD--------------GS----------------- 205 (315)
T ss_pred ccccc---c---------EEEEEE-------C-------------CC--------------CC-----------------
Confidence 55421 1 122222 1 11 11
Q ss_pred EecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC
Q 002446 341 VNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP 420 (921)
Q Consensus 341 ~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP 420 (921)
..++++.+|.+.+||+..++.+..+ .|..+|.+|+|+|
T Consensus 206 -----------------------------------------lcasGgkdg~~~LwdL~~~k~lysl-~a~~~v~sl~fsp 243 (315)
T KOG0279|consen 206 -----------------------------------------LCASGGKDGEAMLWDLNEGKNLYSL-EAFDIVNSLCFSP 243 (315)
T ss_pred -----------------------------------------EEecCCCCceEEEEEccCCceeEec-cCCCeEeeEEecC
Confidence 1123567899999999999987665 5678999999999
Q ss_pred CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe---ccc----ccccEEEEEEccCCCEEEEEeCCCcE
Q 002446 421 SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ---RGL----TNAVIQDISFSDDSNWIMISSSRGTS 493 (921)
Q Consensus 421 dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~---RG~----t~a~I~sIaFSPDg~~LAsgS~DgTV 493 (921)
+--.|+.|-.. .|+|||+.+.. .+.+|+ -|. ....-.+++||+||+.|..|-.|+.|
T Consensus 244 nrywL~~at~~--sIkIwdl~~~~--------------~v~~l~~d~~g~s~~~~~~~clslaws~dG~tLf~g~td~~i 307 (315)
T KOG0279|consen 244 NRYWLCAATAT--SIKIWDLESKA--------------VVEELKLDGIGPSSKAGDPICLSLAWSADGQTLFAGYTDNVI 307 (315)
T ss_pred CceeEeeccCC--ceEEEeccchh--------------hhhhccccccccccccCCcEEEEEEEcCCCcEEEeeecCCcE
Confidence 98888876644 59999999861 111111 011 01124678999999999999999999
Q ss_pred EEEecCC
Q 002446 494 HLFAINP 500 (921)
Q Consensus 494 hVWdi~~ 500 (921)
++|.+..
T Consensus 308 rv~qv~~ 314 (315)
T KOG0279|consen 308 RVWQVAK 314 (315)
T ss_pred EEEEeec
Confidence 9998854
No 42
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.68 E-value=3e-15 Score=155.29 Aligned_cols=251 Identities=14% Similarity=0.195 Sum_probs=183.7
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+.+++.|.-++||- ||+ -||..|.+..+++|+... +.+.+..+.|.-.|..+....+. .
T Consensus 14 ~~~qgaV~avryN~---dGn---Y~ltcGsdrtvrLWNp~r-g~liktYsghG~EVlD~~~s~Dn--------------s 72 (307)
T KOG0316|consen 14 DCAQGAVRAVRYNV---DGN---YCLTCGSDRTVRLWNPLR-GALIKTYSGHGHEVLDAALSSDN--------------S 72 (307)
T ss_pred cccccceEEEEEcc---CCC---EEEEcCCCceEEeecccc-cceeeeecCCCceeeeccccccc--------------c
Confidence 56788999999999 874 899999999999999987 67888899898888887765421 1
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC--CEEEE-
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS--RVVAI- 240 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~--riLAV- 240 (921)
-++.|++ | +.|.+||..||+.++.++- ...|.+|+||. .+|+.
T Consensus 73 kf~s~Gg----------D-----------------------k~v~vwDV~TGkv~Rr~rgH~aqVNtV~fNeesSVv~Sg 119 (307)
T KOG0316|consen 73 KFASCGG----------D-----------------------KAVQVWDVNTGKVDRRFRGHLAQVNTVRFNEESSVVASG 119 (307)
T ss_pred ccccCCC----------C-----------------------ceEEEEEcccCeeeeecccccceeeEEEecCcceEEEec
Confidence 1232332 1 6799999999999998875 57999999983 56665
Q ss_pred EeCCEEEEEECCC--CcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 241 CQAAQVHCFDAAT--LEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 241 a~d~~I~IwDl~T--~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
+.|.+|++||-+. .++++.+.+..+ +.+.+ ..
T Consensus 120 sfD~s~r~wDCRS~s~ePiQildea~D--------------~V~Si-----~v--------------------------- 153 (307)
T KOG0316|consen 120 SFDSSVRLWDCRSRSFEPIQILDEAKD--------------GVSSI-----DV--------------------------- 153 (307)
T ss_pred cccceeEEEEcccCCCCccchhhhhcC--------------ceeEE-----Ee---------------------------
Confidence 7899999999764 344444432211 00000 00
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
++ -.++.+..||+++.||+.
T Consensus 154 --------------~~----------------------------------------------heIvaGS~DGtvRtydiR 173 (307)
T KOG0316|consen 154 --------------AE----------------------------------------------HEIVAGSVDGTVRTYDIR 173 (307)
T ss_pred --------------cc----------------------------------------------cEEEeeccCCcEEEEEee
Confidence 00 012345668999999999
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccccc-EEEEEE
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAV-IQDISF 477 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~-I~sIaF 477 (921)
.|+.....-+| ||+|++|++||..+..++-|++ +|+-|-.++ +.+ .-..||.+.. =.+++|
T Consensus 174 ~G~l~sDy~g~--pit~vs~s~d~nc~La~~l~st-lrLlDk~tG--------------klL-~sYkGhkn~eykldc~l 235 (307)
T KOG0316|consen 174 KGTLSSDYFGH--PITSVSFSKDGNCSLASSLDST-LRLLDKETG--------------KLL-KSYKGHKNMEYKLDCCL 235 (307)
T ss_pred cceeehhhcCC--cceeEEecCCCCEEEEeeccce-eeecccchh--------------HHH-HHhcccccceeeeeeee
Confidence 99876555554 9999999999999999999987 899998876 222 2223544332 457889
Q ss_pred ccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCC
Q 002446 478 SDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDAN 513 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~ 513 (921)
+.-...+++||.||.|.+||+........+..|+..
T Consensus 236 ~qsdthV~sgSEDG~Vy~wdLvd~~~~sk~~~~~~v 271 (307)
T KOG0316|consen 236 NQSDTHVFSGSEDGKVYFWDLVDETQISKLSVVSTV 271 (307)
T ss_pred cccceeEEeccCCceEEEEEeccceeeeeeccCCce
Confidence 988999999999999999999887666666666443
No 43
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.67 E-value=2.8e-15 Score=171.09 Aligned_cols=247 Identities=16% Similarity=0.216 Sum_probs=185.2
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLL 166 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLL 166 (921)
+.|+|-.+.|-+-| +=+|+.=|++.++|||-++.. ..+-+.-.+-|||.++++++ ..-+
T Consensus 12 rSdRVKsVd~HPte------Pw~la~LynG~V~IWnyetqt-mVksfeV~~~PvRa~kfiaR--------------knWi 70 (794)
T KOG0276|consen 12 RSDRVKSVDFHPTE------PWILAALYNGDVQIWNYETQT-MVKSFEVSEVPVRAAKFIAR--------------KNWI 70 (794)
T ss_pred cCCceeeeecCCCC------ceEEEeeecCeeEEEecccce-eeeeeeecccchhhheeeec--------------cceE
Confidence 67889999998722 356666667779999999832 22334445789998888863 2344
Q ss_pred EEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC---CEEEEEe
Q 002446 167 VFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS---RVVAICQ 242 (921)
Q Consensus 167 Avv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~---riLAVa~ 242 (921)
++..| | ..||+|+..|++.|++++- +.-|++|+.-+ -+|..+.
T Consensus 71 v~GsD----------D-----------------------~~IrVfnynt~ekV~~FeAH~DyIR~iavHPt~P~vLtsSD 117 (794)
T KOG0276|consen 71 VTGSD----------D-----------------------MQIRVFNYNTGEKVKTFEAHSDYIRSIAVHPTLPYVLTSSD 117 (794)
T ss_pred EEecC----------C-----------------------ceEEEEecccceeeEEeeccccceeeeeecCCCCeEEecCC
Confidence 33332 2 5699999999999999985 66899999953 3455566
Q ss_pred CCEEEEEECCCC-cEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 243 AAQVHCFDAATL-EIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 243 d~~I~IwDl~T~-~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
|-+|++||-... .+.+++++|.-. .|. +|+-+++
T Consensus 118 Dm~iKlW~we~~wa~~qtfeGH~Hy--------------VMq-----v~fnPkD-------------------------- 152 (794)
T KOG0276|consen 118 DMTIKLWDWENEWACEQTFEGHEHY--------------VMQ-----VAFNPKD-------------------------- 152 (794)
T ss_pred ccEEEEeeccCceeeeeEEcCcceE--------------EEE-----EEecCCC--------------------------
Confidence 779999998754 567777776321 121 2222100
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
+.+|+++.-|++|+||.+.+..
T Consensus 153 ----------------------------------------------------------~ntFaS~sLDrTVKVWslgs~~ 174 (794)
T KOG0276|consen 153 ----------------------------------------------------------PNTFASASLDRTVKVWSLGSPH 174 (794)
T ss_pred ----------------------------------------------------------ccceeeeeccccEEEEEcCCCC
Confidence 1135566778999999999999
Q ss_pred eEEEeccCCCCeEEEEECCCC--CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc
Q 002446 402 VIAQFRAHKSPISALCFDPSG--ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD 479 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdG--tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP 479 (921)
+..+|++|...|.|++|=|-| -+|+||++|-+ |+|||..+. .++.+| .||++ .|..++|.|
T Consensus 175 ~nfTl~gHekGVN~Vdyy~~gdkpylIsgaDD~t-iKvWDyQtk--------------~CV~TL-eGHt~-Nvs~v~fhp 237 (794)
T KOG0276|consen 175 PNFTLEGHEKGVNCVDYYTGGDKPYLISGADDLT-IKVWDYQTK--------------SCVQTL-EGHTN-NVSFVFFHP 237 (794)
T ss_pred CceeeeccccCcceEEeccCCCcceEEecCCCce-EEEeecchH--------------HHHHHh-hcccc-cceEEEecC
Confidence 999999999999999999866 49999999965 999999875 345566 47765 499999999
Q ss_pred CCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 480 DSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
.=.++++||.|||++||.-.++....++
T Consensus 238 ~lpiiisgsEDGTvriWhs~Ty~lE~tL 265 (794)
T KOG0276|consen 238 ELPIIISGSEDGTVRIWNSKTYKLEKTL 265 (794)
T ss_pred CCcEEEEecCCccEEEecCcceehhhhh
Confidence 9999999999999999999988776655
No 44
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.67 E-value=4.4e-15 Score=155.91 Aligned_cols=252 Identities=16% Similarity=0.223 Sum_probs=178.4
Q ss_pred CCCCCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEee-eeecCCEEEEEEecCCCCCccccCcc
Q 002446 82 RDDESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLV-SRYDGPVSFMQMLPRPITSKRSRDKF 159 (921)
Q Consensus 82 ~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elv-S~~dG~Vr~v~~lP~P~~~~~~~d~F 159 (921)
++-.+|..+|..+.|+- +| .-|+.|. +....||+++...-..++. .+|.+.|--+..-|. .
T Consensus 14 r~~~~~~~~v~Sv~wn~---~g----~~lasgs~dktv~v~n~e~~r~~~~~~~~gh~~svdql~w~~~--~-------- 76 (313)
T KOG1407|consen 14 RELQGHVQKVHSVAWNC---DG----TKLASGSFDKTVSVWNLERDRFRKELVYRGHTDSVDQLCWDPK--H-------- 76 (313)
T ss_pred HHhhhhhhcceEEEEcc---cC----ceeeecccCCceEEEEecchhhhhhhcccCCCcchhhheeCCC--C--------
Confidence 45567899999999998 77 4555555 6668999999853333433 455556665544432 1
Q ss_pred ccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCE
Q 002446 160 AEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRV 237 (921)
Q Consensus 160 ~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~ri 237 (921)
-++++.+.++ .+||+||.+++++++.+.-+..=..+.++ +.+
T Consensus 77 ---~d~~atas~d---------------------------------k~ir~wd~r~~k~~~~i~~~~eni~i~wsp~g~~ 120 (313)
T KOG1407|consen 77 ---PDLFATASGD---------------------------------KTIRIWDIRSGKCTARIETKGENINITWSPDGEY 120 (313)
T ss_pred ---CcceEEecCC---------------------------------ceEEEEEeccCcEEEEeeccCcceEEEEcCCCCE
Confidence 2566666532 67999999999999999987666667776 466
Q ss_pred EEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccc
Q 002446 238 VAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFS 316 (921)
Q Consensus 238 LAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~ 316 (921)
+++ .-+..|.++|+++.+.....+-. + -.+-++ +. ++
T Consensus 121 ~~~~~kdD~it~id~r~~~~~~~~~~~-----~--------e~ne~~-------w~----------------~~------ 158 (313)
T KOG1407|consen 121 IAVGNKDDRITFIDARTYKIVNEEQFK-----F--------EVNEIS-------WN----------------NS------ 158 (313)
T ss_pred EEEecCcccEEEEEecccceeehhccc-----c--------eeeeee-------ec----------------CC------
Confidence 666 66789999999987754432210 0 001010 00 00
Q ss_pred cccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEE
Q 002446 317 GFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRD 396 (921)
Q Consensus 317 ~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwD 396 (921)
++ .|.-+...|+|.|..
T Consensus 159 ---------------------------nd------------------------------------~Fflt~GlG~v~ILs 175 (313)
T KOG1407|consen 159 ---------------------------ND------------------------------------LFFLTNGLGCVEILS 175 (313)
T ss_pred ---------------------------CC------------------------------------EEEEecCCceEEEEe
Confidence 00 011112348999999
Q ss_pred CCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 397 IVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 397 l~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
....+++..+++|....-|++|+|+|++||+||.|. .+-+||+..- .++..+.|- ...|..|+
T Consensus 176 ypsLkpv~si~AH~snCicI~f~p~GryfA~GsADA-lvSLWD~~EL--------------iC~R~isRl--dwpVRTlS 238 (313)
T KOG1407|consen 176 YPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADA-LVSLWDVDEL--------------ICERCISRL--DWPVRTLS 238 (313)
T ss_pred ccccccccccccCCcceEEEEECCCCceEeeccccc-eeeccChhHh--------------hhheeeccc--cCceEEEE
Confidence 999999999999999999999999999999999996 5999999874 344444442 24599999
Q ss_pred EccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 477 FSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
||.||++||++|.|.-|-|=.+.++.....++
T Consensus 239 FS~dg~~lASaSEDh~IDIA~vetGd~~~eI~ 270 (313)
T KOG1407|consen 239 FSHDGRMLASASEDHFIDIAEVETGDRVWEIP 270 (313)
T ss_pred eccCcceeeccCccceEEeEecccCCeEEEee
Confidence 99999999999999999988887765544443
No 45
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.67 E-value=1.7e-14 Score=167.54 Aligned_cols=265 Identities=18% Similarity=0.278 Sum_probs=182.4
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
..++|-+.|..+...+ || ++++.|.++| ++|||... +-|.-.++.|...|..+++..+
T Consensus 345 KQQgH~~~i~~l~YSp---Dg----q~iaTG~eDgKVKvWn~~S-gfC~vTFteHts~Vt~v~f~~~------------- 403 (893)
T KOG0291|consen 345 KQQGHSDRITSLAYSP---DG----QLIATGAEDGKVKVWNTQS-GFCFVTFTEHTSGVTAVQFTAR------------- 403 (893)
T ss_pred eccccccceeeEEECC---CC----cEEEeccCCCcEEEEeccC-ceEEEEeccCCCceEEEEEEec-------------
Confidence 4457777788888777 76 7888888665 99999987 6788889999999999998642
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEE----cCCE
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRC----SSRV 237 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~----S~ri 237 (921)
.+-+|..+-| ++||.||++....-+++.-|.++.-.+. ++.+
T Consensus 404 g~~llssSLD----------------------------------GtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGel 449 (893)
T KOG0291|consen 404 GNVLLSSSLD----------------------------------GTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGEL 449 (893)
T ss_pred CCEEEEeecC----------------------------------CeEEeeeecccceeeeecCCCceeeeEEEEcCCCCE
Confidence 1223322222 7899999999999999999887654433 4677
Q ss_pred EEE-EeCC-EEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccc
Q 002446 238 VAI-CQAA-QVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSF 315 (921)
Q Consensus 238 LAV-a~d~-~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~ 315 (921)
|.+ +++. .|++|++.|++.+-.|.+|.. |+. -|++. |.
T Consensus 450 V~AG~~d~F~IfvWS~qTGqllDiLsGHEg---------------PVs----~l~f~-------------~~-------- 489 (893)
T KOG0291|consen 450 VCAGAQDSFEIFVWSVQTGQLLDILSGHEG---------------PVS----GLSFS-------------PD-------- 489 (893)
T ss_pred EEeeccceEEEEEEEeecCeeeehhcCCCC---------------cce----eeEEc-------------cc--------
Confidence 666 4443 899999999999988887743 221 12222 00
Q ss_pred ccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEE
Q 002446 316 SGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVR 395 (921)
Q Consensus 316 ~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~Iw 395 (921)
|+ +++++.-|.+|++|
T Consensus 490 ------~~----------------------------------------------------------~LaS~SWDkTVRiW 505 (893)
T KOG0291|consen 490 ------GS----------------------------------------------------------LLASGSWDKTVRIW 505 (893)
T ss_pred ------cC----------------------------------------------------------eEEeccccceEEEE
Confidence 00 12344567899999
Q ss_pred ECCCCc-eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC-----CCCCccCCCCceeEEEEEeccccc
Q 002446 396 DIVSKN-VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL-----GTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 396 Dl~s~~-~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~-----~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
|+-... .+.++ .+.+-+.+++|+|||+-||.+..||. |.+||+..+.. |.-...+.... ....+-+.....
T Consensus 506 ~if~s~~~vEtl-~i~sdvl~vsfrPdG~elaVaTldgq-Itf~d~~~~~q~~~IdgrkD~~~gR~~-~D~~ta~~sa~~ 582 (893)
T KOG0291|consen 506 DIFSSSGTVETL-EIRSDVLAVSFRPDGKELAVATLDGQ-ITFFDIKEAVQVGSIDGRKDLSGGRKE-TDRITAENSAKG 582 (893)
T ss_pred EeeccCceeeeE-eeccceeEEEEcCCCCeEEEEEecce-EEEEEhhhceeeccccchhhccccccc-cceeehhhcccC
Confidence 987653 33333 46778999999999999999999997 99999987521 00000000000 000010000011
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
..++.|++|+||++|.+|+....|.||++.+.--...++.
T Consensus 583 K~Ftti~ySaDG~~IlAgG~sn~iCiY~v~~~vllkkfqi 622 (893)
T KOG0291|consen 583 KTFTTICYSADGKCILAGGESNSICIYDVPEGVLLKKFQI 622 (893)
T ss_pred CceEEEEEcCCCCEEEecCCcccEEEEECchhheeeeEEe
Confidence 1389999999999999999999999999988755556653
No 46
>PTZ00421 coronin; Provisional
Probab=99.67 E-value=5.1e-14 Score=165.05 Aligned_cols=223 Identities=14% Similarity=0.123 Sum_probs=152.4
Q ss_pred CcEEEEEccCCCCeEE---eeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCC
Q 002446 116 SGFQVWDVEEADNVHD---LVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTS 192 (921)
Q Consensus 116 ~GfqVWDv~~~~~~~e---lvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~ 192 (921)
+|+.|+.++..|.... ++..|.++|..+++.|. ...+|+.++. |
T Consensus 51 gg~~v~~~~~~G~~~~~~~~l~GH~~~V~~v~fsP~-------------d~~~LaSgS~----------D---------- 97 (493)
T PTZ00421 51 GSTAVLKHTDYGKLASNPPILLGQEGPIIDVAFNPF-------------DPQKLFTASE----------D---------- 97 (493)
T ss_pred CceEEeeccccccCCCCCceEeCCCCCEEEEEEcCC-------------CCCEEEEEeC----------C----------
Confidence 4455555554454332 56789999999999862 1135655543 2
Q ss_pred CCcCCCCCCCCCCcEEEEEECCCCc-------EEEEEe-CCCCEEEEEEcC---CEEEE-EeCCEEEEEECCCCcEEEEE
Q 002446 193 ANYHDLGNGSSVPTVVHFYSLRSQS-------YVHMLK-FRSPIYSVRCSS---RVVAI-CQAAQVHCFDAATLEIEYAI 260 (921)
Q Consensus 193 ~~~h~~g~~~~~~~tVrIWDL~Tg~-------~V~tL~-f~s~V~sV~~S~---riLAV-a~d~~I~IwDl~T~~~l~tL 260 (921)
++|++||+.++. .+..|. +...|..|+|++ ++|++ +.|++|+|||+.+++.+.++
T Consensus 98 -------------gtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg~~~~~l 164 (493)
T PTZ00421 98 -------------GTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERGKAVEVI 164 (493)
T ss_pred -------------CEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCCeEEEEE
Confidence 789999998763 455565 457899999973 56776 67899999999999887777
Q ss_pred ecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhccee
Q 002446 261 LTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGI 340 (921)
Q Consensus 261 ~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl 340 (921)
..|.. .+ ..|++.. + |.
T Consensus 165 ~~h~~---------------~V----~sla~sp-------------d--------------G~----------------- 181 (493)
T PTZ00421 165 KCHSD---------------QI----TSLEWNL-------------D--------------GS----------------- 181 (493)
T ss_pred cCCCC---------------ce----EEEEEEC-------------C--------------CC-----------------
Confidence 65532 11 1223321 0 10
Q ss_pred EecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCe-EEEEEC
Q 002446 341 VNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPI-SALCFD 419 (921)
Q Consensus 341 ~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pI-saLaFS 419 (921)
.++++..+|+|+|||+.+++.+..+.+|.+.+ ..+.|.
T Consensus 182 -----------------------------------------lLatgs~Dg~IrIwD~rsg~~v~tl~~H~~~~~~~~~w~ 220 (493)
T PTZ00421 182 -----------------------------------------LLCTTSKDKKLNIIDPRDGTIVSSVEAHASAKSQRCLWA 220 (493)
T ss_pred -----------------------------------------EEEEecCCCEEEEEECCCCcEEEEEecCCCCcceEEEEc
Confidence 12234568999999999999999999998764 568899
Q ss_pred CCCCEEEEEe----cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe-CCCcEE
Q 002446 420 PSGILLVTAS----VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS-SRGTSH 494 (921)
Q Consensus 420 PdGtlLATaS----~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS-~DgTVh 494 (921)
|++.+|++++ .|++ |+|||+.... ..+... .......+....|++|+++|++++ .|++|+
T Consensus 221 ~~~~~ivt~G~s~s~Dr~-VklWDlr~~~-------------~p~~~~-~~d~~~~~~~~~~d~d~~~L~lggkgDg~Ir 285 (493)
T PTZ00421 221 KRKDLIITLGCSKSQQRQ-IMLWDTRKMA-------------SPYSTV-DLDQSSALFIPFFDEDTNLLYIGSKGEGNIR 285 (493)
T ss_pred CCCCeEEEEecCCCCCCe-EEEEeCCCCC-------------CceeEe-ccCCCCceEEEEEcCCCCEEEEEEeCCCeEE
Confidence 9988888765 3665 9999997640 111111 112223366778999999999988 499999
Q ss_pred EEecCCCCC
Q 002446 495 LFAINPLGG 503 (921)
Q Consensus 495 VWdi~~~g~ 503 (921)
+|++.....
T Consensus 286 iwdl~~~~~ 294 (493)
T PTZ00421 286 CFELMNERL 294 (493)
T ss_pred EEEeeCCce
Confidence 999987543
No 47
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.67 E-value=3.3e-15 Score=173.36 Aligned_cols=224 Identities=17% Similarity=0.295 Sum_probs=171.7
Q ss_pred eEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 108 RVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 108 ~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
+++++|+.+| +||||+..+ ...|....|+|.+..++.+|+.. .| +.++
T Consensus 425 ~~Iv~G~k~Gel~vfdlaS~-~l~Eti~AHdgaIWsi~~~pD~~-------g~---------vT~s-------------- 473 (888)
T KOG0306|consen 425 RYIVLGTKNGELQVFDLASA-SLVETIRAHDGAIWSISLSPDNK-------GF---------VTGS-------------- 473 (888)
T ss_pred ceEEEeccCCceEEEEeehh-hhhhhhhccccceeeeeecCCCC-------ce---------EEec--------------
Confidence 7888899887 899999884 45567778999999998887521 11 1111
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCC-----CcE--------EEEEeCCCCEEEEEEc--CCEEEE-EeCCEEEEEE
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRS-----QSY--------VHMLKFRSPIYSVRCS--SRVVAI-CQAAQVHCFD 250 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~T-----g~~--------V~tL~f~s~V~sV~~S--~riLAV-a~d~~I~IwD 250 (921)
.+++|+|||.+- |.. -++|+++..|.+|++| +++||| -++++++||=
T Consensus 474 -----------------aDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyf 536 (888)
T KOG0306|consen 474 -----------------ADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYF 536 (888)
T ss_pred -----------------CCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEE
Confidence 228999999742 111 2567889999999998 699999 5789999999
Q ss_pred CCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhh
Q 002446 251 AATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAK 330 (921)
Q Consensus 251 l~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~ 330 (921)
+.|++-.-+|-+|..|.- .|.+ + |+ +
T Consensus 537 lDtlKFflsLYGHkLPV~------------smDI-------S-------------~D--------------S-------- 562 (888)
T KOG0306|consen 537 LDTLKFFLSLYGHKLPVL------------SMDI-------S-------------PD--------------S-------- 562 (888)
T ss_pred ecceeeeeeeccccccee------------EEec-------c-------------CC--------------c--------
Confidence 999987777767654211 1111 0 11 0
Q ss_pred hcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCC
Q 002446 331 ESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHK 410 (921)
Q Consensus 331 ~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~ 410 (921)
| .++++..|..|+||-++=|.+-..|-||.
T Consensus 563 ---k-----------------------------------------------livTgSADKnVKiWGLdFGDCHKS~fAHd 592 (888)
T KOG0306|consen 563 ---K-----------------------------------------------LIVTGSADKNVKIWGLDFGDCHKSFFAHD 592 (888)
T ss_pred ---C-----------------------------------------------eEEeccCCCceEEeccccchhhhhhhccc
Confidence 0 12344567889999999999999999999
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
.+|.++.|=|...++.||+.||. |+-||-... .++.+| +||+ ..|+|++-+|+|.|++++|.|
T Consensus 593 DSvm~V~F~P~~~~FFt~gKD~k-vKqWDg~kF--------------e~iq~L-~~H~-~ev~cLav~~~G~~vvs~shD 655 (888)
T KOG0306|consen 593 DSVMSVQFLPKTHLFFTCGKDGK-VKQWDGEKF--------------EEIQKL-DGHH-SEVWCLAVSPNGSFVVSSSHD 655 (888)
T ss_pred CceeEEEEcccceeEEEecCcce-EEeechhhh--------------hhheee-ccch-heeeeeEEcCCCCeEEeccCC
Confidence 99999999999999999999986 999998764 556666 4554 469999999999999999999
Q ss_pred CcEEEEecCC
Q 002446 491 GTSHLFAINP 500 (921)
Q Consensus 491 gTVhVWdi~~ 500 (921)
.+|++|....
T Consensus 656 ~sIRlwE~td 665 (888)
T KOG0306|consen 656 KSIRLWERTD 665 (888)
T ss_pred ceeEeeeccC
Confidence 9999998654
No 48
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.66 E-value=5.3e-14 Score=153.24 Aligned_cols=289 Identities=17% Similarity=0.202 Sum_probs=182.3
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
+..+|||.|+.+.|.. |+ .+|+.|--.| ++||.+.+.....++. ++|.-+.++.....
T Consensus 101 eltgHKDSVt~~~Fsh---dg----tlLATGdmsG~v~v~~~stg~~~~~~~----~e~~dieWl~WHp~---------- 159 (399)
T KOG0296|consen 101 ELTGHKDSVTCCSFSH---DG----TLLATGDMSGKVLVFKVSTGGEQWKLD----QEVEDIEWLKWHPR---------- 159 (399)
T ss_pred EecCCCCceEEEEEcc---Cc----eEEEecCCCccEEEEEcccCceEEEee----cccCceEEEEeccc----------
Confidence 4458999999999999 77 6888887555 8999999854444443 56666666654211
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCE-
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRV- 237 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~ri- 237 (921)
.++|+ ++. .| +.|-.|.+..+.+.+.+.- .+++..=+|. ++.
T Consensus 160 -a~ill-AG~---------~D-----------------------GsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~ 205 (399)
T KOG0296|consen 160 -AHILL-AGS---------TD-----------------------GSVWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRI 205 (399)
T ss_pred -ccEEE-eec---------CC-----------------------CcEEEEECCCcceeeEecCCCCCcccccccCCCceE
Confidence 13333 332 12 5688999999877777765 4577766674 444
Q ss_pred EEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC-ceEEecCCCceecCCCccCCcccccccccc
Q 002446 238 VAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP-RWLAYSGSPVVVSNDGRVNPQHLMQSRSFS 316 (921)
Q Consensus 238 LAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp-RwLAyas~~~~~s~~GrvsPq~l~~s~~~~ 316 (921)
+....+++|++||+.|++.++.+.... +.+ ..+++++. -|+++..+. .+ +-++.
T Consensus 206 ~tgy~dgti~~Wn~ktg~p~~~~~~~e---~~~--------~~~~~~~~~~~~~~~g~~-----e~---~~~~~------ 260 (399)
T KOG0296|consen 206 LTGYDDGTIIVWNPKTGQPLHKITQAE---GLE--------LPCISLNLAGSTLTKGNS-----EG---VACGV------ 260 (399)
T ss_pred EEEecCceEEEEecCCCceeEEecccc---cCc--------CCccccccccceeEeccC-----Cc---cEEEE------
Confidence 445778999999999999998886321 110 11222221 233333211 00 00000
Q ss_pred cccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCC---cCCcccccCCCCCCCcccCcccccCCCCEEE
Q 002446 317 GFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDS---QNSLQSAIPGGKSNGTVNGHFPDADNVGMVI 393 (921)
Q Consensus 317 ~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~---~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~ 393 (921)
....|+++.... | ....+.+.. ..++.+.....+ -...+.+.-+|+|.
T Consensus 261 -~~~sgKVv~~~n--------------~---------~~~~l~~~~e~~~esve~~~~ss~-----lpL~A~G~vdG~i~ 311 (399)
T KOG0296|consen 261 -NNGSGKVVNCNN--------------G---------TVPELKPSQEELDESVESIPSSSK-----LPLAACGSVDGTIA 311 (399)
T ss_pred -ccccceEEEecC--------------C---------CCccccccchhhhhhhhhcccccc-----cchhhcccccceEE
Confidence 001122111100 0 000011111 111111111110 11334566789999
Q ss_pred EEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 394 VRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 394 IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
|||+.+.++ +++-.|..+|..|.|-+ -.+|+||+.+|+ ||+||..+| .+++++ +||.. .|+
T Consensus 312 iyD~a~~~~-R~~c~he~~V~~l~w~~-t~~l~t~c~~g~-v~~wDaRtG--------------~l~~~y-~GH~~-~Il 372 (399)
T KOG0296|consen 312 IYDLAASTL-RHICEHEDGVTKLKWLN-TDYLLTACANGK-VRQWDARTG--------------QLKFTY-TGHQM-GIL 372 (399)
T ss_pred EEecccchh-heeccCCCceEEEEEcC-cchheeeccCce-EEeeecccc--------------ceEEEE-ecCch-hee
Confidence 999988765 56667999999999999 788999999997 999999997 455555 68754 599
Q ss_pred EEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 474 DISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+++.+||.++++++|.|+|.+||++.
T Consensus 373 ~f~ls~~~~~vvT~s~D~~a~VF~v~ 398 (399)
T KOG0296|consen 373 DFALSPQKRLVVTVSDDNTALVFEVP 398 (399)
T ss_pred EEEEcCCCcEEEEecCCCeEEEEecC
Confidence 99999999999999999999999874
No 49
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.65 E-value=2.5e-15 Score=165.44 Aligned_cols=237 Identities=16% Similarity=0.243 Sum_probs=176.2
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLL 166 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLL 166 (921)
....|+-..||. ++ +.+|+.++++..++|+++. ...+..++.|.+.|.++++.-. + .
T Consensus 218 s~g~it~~d~d~---~~---~~~iAas~d~~~r~Wnvd~-~r~~~TLsGHtdkVt~ak~~~~------------~----~ 274 (459)
T KOG0288|consen 218 SLGNITSIDFDS---DN---KHVIAASNDKNLRLWNVDS-LRLRHTLSGHTDKVTAAKFKLS------------H----S 274 (459)
T ss_pred cCCCcceeeecC---CC---ceEEeecCCCceeeeeccc-hhhhhhhcccccceeeehhhcc------------c----c
Confidence 345577888887 55 5899999999999999998 4677789999999999987531 1 1
Q ss_pred EEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEE-EeCCE
Q 002446 167 VFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAI-CQAAQ 245 (921)
Q Consensus 167 Avv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAV-a~d~~ 245 (921)
+++++. .+.+|++||+....|.+++-+-+.+.+|.++...++. =.|++
T Consensus 275 ~vVsgs-------------------------------~DRtiK~WDl~k~~C~kt~l~~S~cnDI~~~~~~~~SgH~Dkk 323 (459)
T KOG0288|consen 275 RVVSGS-------------------------------ADRTIKLWDLQKAYCSKTVLPGSQCNDIVCSISDVISGHFDKK 323 (459)
T ss_pred ceeecc-------------------------------ccchhhhhhhhhhheeccccccccccceEecceeeeecccccc
Confidence 244431 2388999999999999999999999999998655555 36889
Q ss_pred EEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcce
Q 002446 246 VHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRV 325 (921)
Q Consensus 246 I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~V 325 (921)
|++||+++..+.+.+..... +..+.+ . +. |-
T Consensus 324 vRfwD~Rs~~~~~sv~~gg~-------------vtSl~l-------s-------------~~--------------g~-- 354 (459)
T KOG0288|consen 324 VRFWDIRSADKTRSVPLGGR-------------VTSLDL-------S-------------MD--------------GL-- 354 (459)
T ss_pred eEEEeccCCceeeEeecCcc-------------eeeEee-------c-------------cC--------------Ce--
Confidence 99999999887776643210 000110 0 00 00
Q ss_pred eehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEE
Q 002446 326 AHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQ 405 (921)
Q Consensus 326 a~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~ 405 (921)
.+.+...+.++.+.|+.+......
T Consensus 355 --------------------------------------------------------~lLsssRDdtl~viDlRt~eI~~~ 378 (459)
T KOG0288|consen 355 --------------------------------------------------------ELLSSSRDDTLKVIDLRTKEIRQT 378 (459)
T ss_pred --------------------------------------------------------EEeeecCCCceeeeecccccEEEE
Confidence 011123456788999999888888
Q ss_pred eccCC----CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCC
Q 002446 406 FRAHK----SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDS 481 (921)
Q Consensus 406 ~~aH~----~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg 481 (921)
|.+-. +..+.+.|||+|.|+|+||.||. |+||++.++ .+...+.--..++.|.+++|+|-|
T Consensus 379 ~sA~g~k~asDwtrvvfSpd~~YvaAGS~dgs-v~iW~v~tg--------------KlE~~l~~s~s~~aI~s~~W~~sG 443 (459)
T KOG0288|consen 379 FSAEGFKCASDWTRVVFSPDGSYVAAGSADGS-VYIWSVFTG--------------KLEKVLSLSTSNAAITSLSWNPSG 443 (459)
T ss_pred eeccccccccccceeEECCCCceeeeccCCCc-EEEEEccCc--------------eEEEEeccCCCCcceEEEEEcCCC
Confidence 87432 45889999999999999999997 899999986 333444433333359999999999
Q ss_pred CEEEEEeCCCcEEEEe
Q 002446 482 NWIMISSSRGTSHLFA 497 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWd 497 (921)
++|++++.++.+.+|.
T Consensus 444 ~~Llsadk~~~v~lW~ 459 (459)
T KOG0288|consen 444 SGLLSADKQKAVTLWT 459 (459)
T ss_pred chhhcccCCcceEecC
Confidence 9999999999999994
No 50
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.65 E-value=2.8e-15 Score=162.54 Aligned_cols=188 Identities=14% Similarity=0.224 Sum_probs=144.6
Q ss_pred cEEEEEECCCCcEEEEEe-CCCCEEEEEEcCC---EEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLK-FRSPIYSVRCSSR---VVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~r---iLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
++++|||+.||++..+|. +-+.|..|++|.+ ++.+..+++|+|||+...+.++..-+|-. +.
T Consensus 173 rtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkvIR~YhGHlS--------------~V 238 (460)
T KOG0285|consen 173 RTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKVIRHYHGHLS--------------GV 238 (460)
T ss_pred ceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEechhhhhHHHhccccc--------------ee
Confidence 899999999999999998 6899999999853 44557889999999998776654433310 00
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
.+ |+ +.|.
T Consensus 239 ~~-----L~-------------------------------------------------------------------lhPT 246 (460)
T KOG0285|consen 239 YC-----LD-------------------------------------------------------------------LHPT 246 (460)
T ss_pred EE-----Ee-------------------------------------------------------------------cccc
Confidence 11 11 1111
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
- ..+++++.|.+++|||+.++..+..|.+|+.+|..+.|.|-.-.++|||.|++ |++||+.
T Consensus 247 l------------------dvl~t~grDst~RvWDiRtr~~V~~l~GH~~~V~~V~~~~~dpqvit~S~D~t-vrlWDl~ 307 (460)
T KOG0285|consen 247 L------------------DVLVTGGRDSTIRVWDIRTRASVHVLSGHTNPVASVMCQPTDPQVITGSHDST-VRLWDLR 307 (460)
T ss_pred c------------------eeEEecCCcceEEEeeecccceEEEecCCCCcceeEEeecCCCceEEecCCce-EEEeeec
Confidence 0 01234567889999999999999999999999999999998778999999997 9999998
Q ss_pred CCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 442 PGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 442 ~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
-+ +.+.++. ++...|.+++..|.-..||++|.|. |+-|++..+.-...+.+|...++
T Consensus 308 ag--------------kt~~tlt--~hkksvral~lhP~e~~fASas~dn-ik~w~~p~g~f~~nlsgh~~iin 364 (460)
T KOG0285|consen 308 AG--------------KTMITLT--HHKKSVRALCLHPKENLFASASPDN-IKQWKLPEGEFLQNLSGHNAIIN 364 (460)
T ss_pred cC--------------ceeEeee--cccceeeEEecCCchhhhhccCCcc-ceeccCCccchhhccccccceee
Confidence 76 3334442 2233499999999999999999885 89999987766667888877666
No 51
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.65 E-value=1.3e-14 Score=162.54 Aligned_cols=234 Identities=20% Similarity=0.298 Sum_probs=167.1
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
=|+.|..+.|-+ || ++|++|-..| +||||..+ -.+...+..|..||..++|.|.- --+
T Consensus 67 Fk~~v~s~~fR~---DG----~LlaaGD~sG~V~vfD~k~-r~iLR~~~ah~apv~~~~f~~~d-------------~t~ 125 (487)
T KOG0310|consen 67 FKDVVYSVDFRS---DG----RLLAAGDESGHVKVFDMKS-RVILRQLYAHQAPVHVTKFSPQD-------------NTM 125 (487)
T ss_pred hccceeEEEeec---CC----eEEEccCCcCcEEEecccc-HHHHHHHhhccCceeEEEecccC-------------CeE
Confidence 478899999999 88 7999998887 79999655 23444567899999999998741 123
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcC---CEEEE-
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSS---RVVAI- 240 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~---riLAV- 240 (921)
|+.++|+ .++++||+.+......|. +...|++.+|++ .+++.
T Consensus 126 l~s~sDd---------------------------------~v~k~~d~s~a~v~~~l~~htDYVR~g~~~~~~~hivvtG 172 (487)
T KOG0310|consen 126 LVSGSDD---------------------------------KVVKYWDLSTAYVQAELSGHTDYVRCGDISPANDHIVVTG 172 (487)
T ss_pred EEecCCC---------------------------------ceEEEEEcCCcEEEEEecCCcceeEeeccccCCCeEEEec
Confidence 4444431 689999999988654554 467899999964 46666
Q ss_pred EeCCEEEEEECCCC-cEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccccc
Q 002446 241 CQAAQVHCFDAATL-EIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFA 319 (921)
Q Consensus 241 a~d~~I~IwDl~T~-~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~ 319 (921)
+.|++|++||+++. ....++. | ++| +. +-|+.+
T Consensus 173 sYDg~vrl~DtR~~~~~v~eln-h----g~p-----------Ve---~vl~lp--------------------------- 206 (487)
T KOG0310|consen 173 SYDGKVRLWDTRSLTSRVVELN-H----GCP-----------VE---SVLALP--------------------------- 206 (487)
T ss_pred CCCceEEEEEeccCCceeEEec-C----CCc-----------ee---eEEEcC---------------------------
Confidence 78999999999987 4444443 2 222 11 112221
Q ss_pred CCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC
Q 002446 320 SNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS 399 (921)
Q Consensus 320 s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s 399 (921)
+|+++ +++ ....|+|||+.+
T Consensus 207 -sgs~i----------------------------------------------------------asA-gGn~vkVWDl~~ 226 (487)
T KOG0310|consen 207 -SGSLI----------------------------------------------------------ASA-GGNSVKVWDLTT 226 (487)
T ss_pred -CCCEE----------------------------------------------------------EEc-CCCeEEEEEecC
Confidence 01111 000 113699999995
Q ss_pred C-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 400 K-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 400 ~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
| +.+..+..|...|+||+|.-+++.|.+++-||+ ++|||+... ..++.+. -.+.|.+|+.|
T Consensus 227 G~qll~~~~~H~KtVTcL~l~s~~~rLlS~sLD~~-VKVfd~t~~--------------Kvv~s~~---~~~pvLsiavs 288 (487)
T KOG0310|consen 227 GGQLLTSMFNHNKTVTCLRLASDSTRLLSGSLDRH-VKVFDTTNY--------------KVVHSWK---YPGPVLSIAVS 288 (487)
T ss_pred CceehhhhhcccceEEEEEeecCCceEeecccccc-eEEEEccce--------------EEEEeee---cccceeeEEec
Confidence 5 555556669999999999999999999999998 899997653 3333332 23469999999
Q ss_pred cCCCEEEEEeCCCcEEEEec
Q 002446 479 DDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi 498 (921)
||++-+++|-.+|.+-+-+.
T Consensus 289 ~dd~t~viGmsnGlv~~rr~ 308 (487)
T KOG0310|consen 289 PDDQTVVIGMSNGLVSIRRR 308 (487)
T ss_pred CCCceEEEecccceeeeehh
Confidence 99999999999999877643
No 52
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.65 E-value=4.2e-15 Score=174.40 Aligned_cols=275 Identities=16% Similarity=0.244 Sum_probs=178.6
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
...+|-.++|-+ .|-.++.+..+| +|+||--- +-+.+-+-.||||||-+.|-|. .||
T Consensus 8 kSsRvKglsFHP-------~rPwILtslHsG~IQlWDYRM-~tli~rFdeHdGpVRgv~FH~~--------------qpl 65 (1202)
T KOG0292|consen 8 KSSRVKGLSFHP-------KRPWILTSLHSGVIQLWDYRM-GTLIDRFDEHDGPVRGVDFHPT--------------QPL 65 (1202)
T ss_pred ccccccceecCC-------CCCEEEEeecCceeeeehhhh-hhHHhhhhccCCccceeeecCC--------------CCe
Confidence 344566777766 467889999887 79999865 4455667789999999988763 366
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC---CEEEEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS---RVVAIC 241 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~---riLAVa 241 (921)
.+..+| | -+|++|+.++.+|+.+|.. -.-|+.+.|-. =+|..+
T Consensus 66 FVSGGD----------D-----------------------ykIkVWnYk~rrclftL~GHlDYVRt~~FHheyPWIlSAS 112 (1202)
T KOG0292|consen 66 FVSGGD----------D-----------------------YKIKVWNYKTRRCLFTLLGHLDYVRTVFFHHEYPWILSAS 112 (1202)
T ss_pred EEecCC----------c-----------------------cEEEEEecccceehhhhccccceeEEeeccCCCceEEEcc
Confidence 543332 2 6799999999999998864 57899999964 344556
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecC-CCceecCCCccCCcccccccccccccC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSG-SPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas-~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
.|.+|+||+-.+.+++.++.+|.-.. |+- .|.+ .+++++ +|
T Consensus 113 DDQTIrIWNwqsr~~iavltGHnHYV--------------McA-----qFhptEDlIVS-------------------aS 154 (1202)
T KOG0292|consen 113 DDQTIRIWNWQSRKCIAVLTGHNHYV--------------MCA-----QFHPTEDLIVS-------------------AS 154 (1202)
T ss_pred CCCeEEEEeccCCceEEEEecCceEE--------------Eee-----ccCCccceEEE-------------------ec
Confidence 77899999999999999998884321 110 1111 111111 00
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
-..+|..|.. +|++ ..+.++.+..+. ..+ ..+..-++--..-
T Consensus 155 LDQTVRVWDi-------sGLR-------------------kk~~~pg~~e~~------~~~------~~~~~dLfg~~Da 196 (1202)
T KOG0292|consen 155 LDQTVRVWDI-------SGLR-------------------KKNKAPGSLEDQ------MRG------QQGNSDLFGQTDA 196 (1202)
T ss_pred ccceEEEEee-------cchh-------------------ccCCCCCCchhh------hhc------cccchhhcCCcCe
Confidence 1111111100 0110 000000000000 000 0011111100011
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
-+...+.+|.-.|+.++|.|.--++++|++|. .|++|..... ..+.+-++ |||.+ .|.++-|.|.
T Consensus 197 VVK~VLEGHDRGVNwaAfhpTlpliVSG~DDR-qVKlWrmnet------------KaWEvDtc-rgH~n-nVssvlfhp~ 261 (1202)
T KOG0292|consen 197 VVKHVLEGHDRGVNWAAFHPTLPLIVSGADDR-QVKLWRMNET------------KAWEVDTC-RGHYN-NVSSVLFHPH 261 (1202)
T ss_pred eeeeeecccccccceEEecCCcceEEecCCcc-eeeEEEeccc------------cceeehhh-hcccC-CcceEEecCc
Confidence 13456789999999999999999999999995 5999998764 34555444 78765 4999999999
Q ss_pred CCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 481 SNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
-..+.+.|.|++|+|||+....+..++
T Consensus 262 q~lIlSnsEDksirVwDm~kRt~v~tf 288 (1202)
T KOG0292|consen 262 QDLILSNSEDKSIRVWDMTKRTSVQTF 288 (1202)
T ss_pred cceeEecCCCccEEEEecccccceeee
Confidence 999999999999999999988777666
No 53
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.64 E-value=1.1e-15 Score=165.00 Aligned_cols=240 Identities=18% Similarity=0.292 Sum_probs=175.8
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVR 163 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~r 163 (921)
.+|...|++..||. ++|+.|. +..++|||+++ ++...++-.|-..|--+++..
T Consensus 234 ~GHtGSVLCLqyd~---------rviisGSSDsTvrvWDv~t-ge~l~tlihHceaVLhlrf~n---------------- 287 (499)
T KOG0281|consen 234 TGHTGSVLCLQYDE---------RVIVSGSSDSTVRVWDVNT-GEPLNTLIHHCEAVLHLRFSN---------------- 287 (499)
T ss_pred hcCCCcEEeeeccc---------eEEEecCCCceEEEEeccC-CchhhHHhhhcceeEEEEEeC----------------
Confidence 47888899998887 7888888 55699999999 666666666777777777652
Q ss_pred CEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEE---EEE-eCCCCEEEEEEcCCEEE
Q 002446 164 PLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYV---HML-KFRSPIYSVRCSSRVVA 239 (921)
Q Consensus 164 PLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V---~tL-~f~s~V~sV~~S~riLA 239 (921)
.++..|+. | .++++||+.+...+ +.| .+...|..|.|+.++++
T Consensus 288 g~mvtcSk----------D-----------------------rsiaVWdm~sps~it~rrVLvGHrAaVNvVdfd~kyIV 334 (499)
T KOG0281|consen 288 GYMVTCSK----------D-----------------------RSIAVWDMASPTDITLRRVLVGHRAAVNVVDFDDKYIV 334 (499)
T ss_pred CEEEEecC----------C-----------------------ceeEEEeccCchHHHHHHHHhhhhhheeeeccccceEE
Confidence 35544442 2 77999999876532 223 24689999999988887
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
. +.|.+|++||..|+++++++.+|.. | +| .|.|-
T Consensus 335 sASgDRTikvW~~st~efvRtl~gHkR--G-------------IA----ClQYr-------------------------- 369 (499)
T KOG0281|consen 335 SASGDRTIKVWSTSTCEFVRTLNGHKR--G-------------IA----CLQYR-------------------------- 369 (499)
T ss_pred EecCCceEEEEeccceeeehhhhcccc--c-------------ce----ehhcc--------------------------
Confidence 7 6788999999999999999987732 1 11 01111
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
|.+ ++++..|.+|++||+.
T Consensus 370 ---~rl----------------------------------------------------------vVSGSSDntIRlwdi~ 388 (499)
T KOG0281|consen 370 ---DRL----------------------------------------------------------VVSGSSDNTIRLWDIE 388 (499)
T ss_pred ---CeE----------------------------------------------------------EEecCCCceEEEEecc
Confidence 111 1234567899999999
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
.|+++..+++|..-|.|+.|+ .+.+++|..||+ |+|||+..+......+ ...++..+-+ +..+|..+.|
T Consensus 389 ~G~cLRvLeGHEeLvRciRFd--~krIVSGaYDGk-ikvWdl~aaldpra~~-----~~~Cl~~lv~--hsgRVFrLQF- 457 (499)
T KOG0281|consen 389 CGACLRVLEGHEELVRCIRFD--NKRIVSGAYDGK-IKVWDLQAALDPRAPA-----STLCLRTLVE--HSGRVFRLQF- 457 (499)
T ss_pred ccHHHHHHhchHHhhhheeec--Cceeeeccccce-EEEEecccccCCcccc-----cchHHHhhhh--ccceeEEEee-
Confidence 999999999999999999995 588999999998 9999998763211110 1123334332 3346888888
Q ss_pred cCCCEEEEEeCCCcEEEEecCCC
Q 002446 479 DDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|...++++|.|.||-|||.-.+
T Consensus 458 -D~fqIvsssHddtILiWdFl~~ 479 (499)
T KOG0281|consen 458 -DEFQIISSSHDDTILIWDFLNG 479 (499)
T ss_pred -cceEEEeccCCCeEEEEEcCCC
Confidence 5677889999999999998664
No 54
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.64 E-value=1.3e-14 Score=154.97 Aligned_cols=263 Identities=19% Similarity=0.264 Sum_probs=175.9
Q ss_pred HhcceeeeccCcchhhhhhhhhccccccCCCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEee
Q 002446 54 ISSYFRIVSSGASTVARSAVSVASSIVERDDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLV 133 (921)
Q Consensus 54 ~s~~~~~~ss~~~t~~~~~a~~~~s~~~~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elv 133 (921)
...+|-..+|-..||.-=-..-....++.....+...|+.++|.. ||. +|++.|.++..++||+.. +.+ ..+
T Consensus 38 ~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~Wsd---dgs---kVf~g~~Dk~~k~wDL~S-~Q~-~~v 109 (347)
T KOG0647|consen 38 QADNLLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSD---DGS---KVFSGGCDKQAKLWDLAS-GQV-SQV 109 (347)
T ss_pred ccCceEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEcc---CCc---eEEeeccCCceEEEEccC-CCe-eee
Confidence 345666666666666411000001111122345677899999998 774 899999999999999998 344 467
Q ss_pred eeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEEC
Q 002446 134 SRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSL 213 (921)
Q Consensus 134 S~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL 213 (921)
..|+++|+++++.+.+. .++| +.++| ++|||+||+
T Consensus 110 ~~Hd~pvkt~~wv~~~~------------~~cl--~TGSW-------------------------------DKTlKfWD~ 144 (347)
T KOG0647|consen 110 AAHDAPVKTCHWVPGMN------------YQCL--VTGSW-------------------------------DKTLKFWDT 144 (347)
T ss_pred eecccceeEEEEecCCC------------ccee--Eeccc-------------------------------ccceeeccc
Confidence 78999999999997532 1333 45555 289999999
Q ss_pred CCCcEEEEEeCCCCEEEEEEcCCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEec
Q 002446 214 RSQSYVHMLKFRSPIYSVRCSSRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYS 292 (921)
Q Consensus 214 ~Tg~~V~tL~f~s~V~sV~~S~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAya 292 (921)
|+...+.+++++..||++.+-..+++| ..++.|.+|+|+.....+....+|... -.|.+|..
T Consensus 145 R~~~pv~t~~LPeRvYa~Dv~~pm~vVata~r~i~vynL~n~~te~k~~~SpLk~-----------------Q~R~va~f 207 (347)
T KOG0647|consen 145 RSSNPVATLQLPERVYAADVLYPMAVVATAERHIAVYNLENPPTEFKRIESPLKW-----------------QTRCVACF 207 (347)
T ss_pred CCCCeeeeeeccceeeehhccCceeEEEecCCcEEEEEcCCCcchhhhhcCcccc-----------------eeeEEEEE
Confidence 999999999999999999998777777 567899999998765544433332211 01333322
Q ss_pred CCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCC
Q 002446 293 GSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPG 372 (921)
Q Consensus 293 s~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~ 372 (921)
-++ . +
T Consensus 208 ~d~-----~--------------------~-------------------------------------------------- 212 (347)
T KOG0647|consen 208 QDK-----D--------------------G-------------------------------------------------- 212 (347)
T ss_pred ecC-----C--------------------c--------------------------------------------------
Confidence 100 0 0
Q ss_pred CCCCCcccCcccccCCCCEEEEEECCCC--ceEEEeccCCC---------CeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 373 GKSNGTVNGHFPDADNVGMVIVRDIVSK--NVIAQFRAHKS---------PISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 373 ~k~~g~v~g~~~s~~~~G~V~IwDl~s~--~~l~~~~aH~~---------pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
++-+.-.|.|-|..+..+ +.-.+|+.|.. +|..|+|.|.-..|||++.||+ +..||-.
T Consensus 213 ----------~alGsiEGrv~iq~id~~~~~~nFtFkCHR~~~~~~~~VYaVNsi~FhP~hgtlvTaGsDGt-f~FWDkd 281 (347)
T KOG0647|consen 213 ----------FALGSIEGRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDVYAVNSIAFHPVHGTLVTAGSDGT-FSFWDKD 281 (347)
T ss_pred ----------eEeeeecceEEEEecCCCCccCceeEEEeccCCCCCCceEEecceEeecccceEEEecCCce-EEEecch
Confidence 000112355555555443 33446666652 5788999999889999999998 9999977
Q ss_pred CCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe
Q 002446 442 PGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS 488 (921)
Q Consensus 442 ~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS 488 (921)
.. ..|++.. .....|.+.+|+.+|.++|-+.
T Consensus 282 ar--------------~kLk~s~--~~~qpItcc~fn~~G~ifaYA~ 312 (347)
T KOG0647|consen 282 AR--------------TKLKTSE--THPQPITCCSFNRNGSIFAYAL 312 (347)
T ss_pred hh--------------hhhhccC--cCCCccceeEecCCCCEEEEEe
Confidence 53 2333322 2345699999999999998664
No 55
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.64 E-value=7.6e-16 Score=172.09 Aligned_cols=264 Identities=11% Similarity=0.141 Sum_probs=189.3
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
.-.+|.+.|..++|=+ ..+ +.+|..|.++.+.||++-+.+.+...+..|..+|+.+++.+..
T Consensus 209 ~~~gH~kgvsai~~fp--~~~---hLlLS~gmD~~vklW~vy~~~~~lrtf~gH~k~Vrd~~~s~~g------------- 270 (503)
T KOG0282|consen 209 NLSGHTKGVSAIQWFP--KKG---HLLLSGGMDGLVKLWNVYDDRRCLRTFKGHRKPVRDASFNNCG------------- 270 (503)
T ss_pred eccCCccccchhhhcc--cee---eEEEecCCCceEEEEEEecCcceehhhhcchhhhhhhhccccC-------------
Confidence 3457888888888866 222 3455555577799999988788888999999999999886531
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVA 239 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLA 239 (921)
+.+|.+.. +++|++||++||+++..++....++.|.|. .+++.
T Consensus 271 ~~fLS~sf----------------------------------D~~lKlwDtETG~~~~~f~~~~~~~cvkf~pd~~n~fl 316 (503)
T KOG0282|consen 271 TSFLSASF----------------------------------DRFLKLWDTETGQVLSRFHLDKVPTCVKFHPDNQNIFL 316 (503)
T ss_pred Ceeeeeec----------------------------------ceeeeeeccccceEEEEEecCCCceeeecCCCCCcEEE
Confidence 23333222 278999999999999999999999999995 25554
Q ss_pred E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
+ .++++|..||+++++.++.+..|- +++- -|-|-
T Consensus 317 ~G~sd~ki~~wDiRs~kvvqeYd~hL---------------g~i~----~i~F~-------------------------- 351 (503)
T KOG0282|consen 317 VGGSDKKIRQWDIRSGKVVQEYDRHL---------------GAIL----DITFV-------------------------- 351 (503)
T ss_pred EecCCCcEEEEeccchHHHHHHHhhh---------------hhee----eeEEc--------------------------
Confidence 4 789999999999998665544331 1110 00010
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
+++ ..|+++..++.|+||+..
T Consensus 352 -----------------------------------------~~g------------------~rFissSDdks~riWe~~ 372 (503)
T KOG0282|consen 352 -----------------------------------------DEG------------------RRFISSSDDKSVRIWENR 372 (503)
T ss_pred -----------------------------------------cCC------------------ceEeeeccCccEEEEEcC
Confidence 000 123445667899999999
Q ss_pred CCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccccc-EEEEE
Q 002446 399 SKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAV-IQDIS 476 (921)
Q Consensus 399 s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~-I~sIa 476 (921)
...++..+. .+.....||+..|+|.+++.=+-|.. |-||.+.+... ...++..+||..+- -..|.
T Consensus 373 ~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQs~dN~-i~ifs~~~~~r------------~nkkK~feGh~vaGys~~v~ 439 (503)
T KOG0282|consen 373 IPVPIKNIADPEMHTMPCLTLHPNGKWFAAQSMDNY-IAIFSTVPPFR------------LNKKKRFEGHSVAGYSCQVD 439 (503)
T ss_pred CCccchhhcchhhccCcceecCCCCCeehhhccCce-EEEEecccccc------------cCHhhhhcceeccCceeeEE
Confidence 887765544 33456778999999999999999865 89999776411 11122234543322 45689
Q ss_pred EccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 477 FSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
|||||++|++|+.||.+.+||-.+......+++|.....
T Consensus 440 fSpDG~~l~SGdsdG~v~~wdwkt~kl~~~lkah~~~ci 478 (503)
T KOG0282|consen 440 FSPDGRTLCSGDSDGKVNFWDWKTTKLVSKLKAHDQPCI 478 (503)
T ss_pred EcCCCCeEEeecCCccEEEeechhhhhhhccccCCcceE
Confidence 999999999999999999999999988889999965544
No 56
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.61 E-value=3.9e-14 Score=151.75 Aligned_cols=230 Identities=19% Similarity=0.286 Sum_probs=159.7
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
.++-.++.+.|-. +. .++..|.++.++++|++.. ....+..|+++|+|++..+. +.
T Consensus 52 ~~~~plL~c~F~d---~~----~~~~G~~dg~vr~~Dln~~--~~~~igth~~~i~ci~~~~~--------------~~- 107 (323)
T KOG1036|consen 52 KHGAPLLDCAFAD---ES----TIVTGGLDGQVRRYDLNTG--NEDQIGTHDEGIRCIEYSYE--------------VG- 107 (323)
T ss_pred ecCCceeeeeccC---Cc----eEEEeccCceEEEEEecCC--cceeeccCCCceEEEEeecc--------------CC-
Confidence 4677899999976 33 7888888999999999983 44577889999999999852 11
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEE-EeCC
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAI-CQAA 244 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAV-a~d~ 244 (921)
.++.++| +++|+|||.+....+.++.-...|+++..++..|+| +.+.
T Consensus 108 -~vIsgsW-------------------------------D~~ik~wD~R~~~~~~~~d~~kkVy~~~v~g~~LvVg~~~r 155 (323)
T KOG1036|consen 108 -CVISGSW-------------------------------DKTIKFWDPRNKVVVGTFDQGKKVYCMDVSGNRLVVGTSDR 155 (323)
T ss_pred -eEEEccc-------------------------------CccEEEEeccccccccccccCceEEEEeccCCEEEEeecCc
Confidence 2344566 278999999987777777777899999999888888 8899
Q ss_pred EEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCC---ceecCCCccCCcccccccccccccCC
Q 002446 245 QVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSP---VVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 245 ~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~---~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
+|.+||++++...++..+.+... .+ |.++.-++. +..+..||++-+.+.+++
T Consensus 156 ~v~iyDLRn~~~~~q~reS~lky----------qt-------R~v~~~pn~eGy~~sSieGRVavE~~d~s~-------- 210 (323)
T KOG1036|consen 156 KVLIYDLRNLDEPFQRRESSLKY----------QT-------RCVALVPNGEGYVVSSIEGRVAVEYFDDSE-------- 210 (323)
T ss_pred eEEEEEcccccchhhhcccccee----------EE-------EEEEEecCCCceEEEeecceEEEEccCCch--------
Confidence 99999999998776655543211 11 233322110 011233333222221110
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
+.. +
T Consensus 211 --------------------------~~~--------------------------------------------------s 214 (323)
T KOG1036|consen 211 --------------------------EAQ--------------------------------------------------S 214 (323)
T ss_pred --------------------------HHh--------------------------------------------------h
Confidence 000 1
Q ss_pred eEEEeccCC---------CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccE
Q 002446 402 VIAQFRAHK---------SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVI 472 (921)
Q Consensus 402 ~l~~~~aH~---------~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I 472 (921)
..-.|++|. -||.+|+|+|--..||||+.||. |.+||+.+. +.++.|++-. ..|
T Consensus 215 kkyaFkCHr~~~~~~~~~yPVNai~Fhp~~~tfaTgGsDG~-V~~Wd~~~r--------------Krl~q~~~~~--~SI 277 (323)
T KOG1036|consen 215 KKYAFKCHRLSEKDTEIIYPVNAIAFHPIHGTFATGGSDGI-VNIWDLFNR--------------KRLKQLAKYE--TSI 277 (323)
T ss_pred hceeEEeeecccCCceEEEEeceeEeccccceEEecCCCce-EEEccCcch--------------hhhhhccCCC--Cce
Confidence 112333332 28999999999888999999995 999999874 4566665432 239
Q ss_pred EEEEEccCCCEEEEEeC
Q 002446 473 QDISFSDDSNWIMISSS 489 (921)
Q Consensus 473 ~sIaFSPDg~~LAsgS~ 489 (921)
-+++|+.||..||++++
T Consensus 278 ~slsfs~dG~~LAia~s 294 (323)
T KOG1036|consen 278 SSLSFSMDGSLLAIASS 294 (323)
T ss_pred EEEEeccCCCeEEEEec
Confidence 99999999999999975
No 57
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.61 E-value=1.2e-12 Score=138.96 Aligned_cols=271 Identities=13% Similarity=0.143 Sum_probs=155.8
Q ss_pred EEEE-EccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 109 VLLL-GYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 109 vLll-G~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
+++. +.++.+.+||+++ ++....+..+.+ ++.+.+.|+ ...|.++...
T Consensus 3 ~~~s~~~d~~v~~~d~~t-~~~~~~~~~~~~-~~~l~~~~d--------------g~~l~~~~~~--------------- 51 (300)
T TIGR03866 3 AYVSNEKDNTISVIDTAT-LEVTRTFPVGQR-PRGITLSKD--------------GKLLYVCASD--------------- 51 (300)
T ss_pred EEEEecCCCEEEEEECCC-CceEEEEECCCC-CCceEECCC--------------CCEEEEEECC---------------
Confidence 4444 4466699999987 455555554333 455666553 1234333321
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEE--eCCEEEEEECCCCcEEEEEecC
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAIC--QAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa--~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
.++|++||+.+++.++.+.....+..+.++ ++.++++ .+++|++||+.+.+.+..+...
T Consensus 52 -----------------~~~v~~~d~~~~~~~~~~~~~~~~~~~~~~~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~~ 114 (300)
T TIGR03866 52 -----------------SDTIQVIDLATGEVIGTLPSGPDPELFALHPNGKILYIANEDDNLVTVIDIETRKVLAEIPVG 114 (300)
T ss_pred -----------------CCeEEEEECCCCcEEEeccCCCCccEEEECCCCCEEEEEcCCCCeEEEEECCCCeEEeEeeCC
Confidence 167999999999998888765556677775 4666553 4689999999998777666422
Q ss_pred CCccCCCCCCCCCccccceeecC--ceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeE
Q 002446 264 PIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIV 341 (921)
Q Consensus 264 p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~ 341 (921)
.. ...++++| ++|+++... +..+..+.....+.+. ..
T Consensus 115 ~~-------------~~~~~~~~dg~~l~~~~~~--------------------------~~~~~~~d~~~~~~~~--~~ 153 (300)
T TIGR03866 115 VE-------------PEGMAVSPDGKIVVNTSET--------------------------TNMAHFIDTKTYEIVD--NV 153 (300)
T ss_pred CC-------------cceEEECCCCCEEEEEecC--------------------------CCeEEEEeCCCCeEEE--EE
Confidence 11 11234433 455544211 0000000000000000 00
Q ss_pred ecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCC-----C--CeE
Q 002446 342 NLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHK-----S--PIS 414 (921)
Q Consensus 342 ~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~-----~--pIs 414 (921)
..+.. . .. ..+.|++ . ..++....+|.|++||+.+++.+..+..+. . ...
T Consensus 154 ~~~~~---~--~~-~~~s~dg---------------~--~l~~~~~~~~~v~i~d~~~~~~~~~~~~~~~~~~~~~~~~~ 210 (300)
T TIGR03866 154 LVDQR---P--RF-AEFTADG---------------K--ELWVSSEIGGTVSVIDVATRKVIKKITFEIPGVHPEAVQPV 210 (300)
T ss_pred EcCCC---c--cE-EEECCCC---------------C--EEEEEcCCCCEEEEEEcCcceeeeeeeecccccccccCCcc
Confidence 00000 0 00 0000111 0 011334557899999999998877765332 1 234
Q ss_pred EEEECCCCCEEEEE-ecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEE-eCCCc
Q 002446 415 ALCFDPSGILLVTA-SVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMIS-SSRGT 492 (921)
Q Consensus 415 aLaFSPdGtlLATa-S~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsg-S~DgT 492 (921)
.++|+|||++++.+ ..+++ |.|||+.++ ..+..+..+ ..+.+++|+|||++|+++ ..+++
T Consensus 211 ~i~~s~dg~~~~~~~~~~~~-i~v~d~~~~--------------~~~~~~~~~---~~~~~~~~~~~g~~l~~~~~~~~~ 272 (300)
T TIGR03866 211 GIKLTKDGKTAFVALGPANR-VAVVDAKTY--------------EVLDYLLVG---QRVWQLAFTPDEKYLLTTNGVSND 272 (300)
T ss_pred ceEECCCCCEEEEEcCCCCe-EEEEECCCC--------------cEEEEEEeC---CCcceEEECCCCCEEEEEcCCCCe
Confidence 68999999986554 33444 899999765 222223222 248899999999999987 46999
Q ss_pred EEEEecCCCCCceeecC
Q 002446 493 SHLFAINPLGGSVNFQP 509 (921)
Q Consensus 493 VhVWdi~~~g~~~~l~~ 509 (921)
|+|||+.+......++.
T Consensus 273 i~v~d~~~~~~~~~~~~ 289 (300)
T TIGR03866 273 VSVIDVAALKVIKSIKV 289 (300)
T ss_pred EEEEECCCCcEEEEEEc
Confidence 99999998765556654
No 58
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.60 E-value=3.8e-14 Score=157.85 Aligned_cols=271 Identities=15% Similarity=0.205 Sum_probs=177.1
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEee-ee--ecCCEEEEEEecCCCCCccccCccccC-
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLV-SR--YDGPVSFMQMLPRPITSKRSRDKFAEV- 162 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elv-S~--~dG~Vr~v~~lP~P~~~~~~~d~F~~~- 162 (921)
....|..+.|-+ . .+.+|+.|+++.++||.++- ++...+ |- ..-|+.++++.|+. ..-.|...
T Consensus 212 s~~~I~sv~FHp---~---~plllvaG~d~~lrifqvDG--k~N~~lqS~~l~~fPi~~a~f~p~G-----~~~i~~s~r 278 (514)
T KOG2055|consen 212 SHGGITSVQFHP---T---APLLLVAGLDGTLRIFQVDG--KVNPKLQSIHLEKFPIQKAEFAPNG-----HSVIFTSGR 278 (514)
T ss_pred CcCCceEEEecC---C---CceEEEecCCCcEEEEEecC--ccChhheeeeeccCccceeeecCCC-----ceEEEeccc
Confidence 456699999988 3 36788889999999999984 454444 33 46899999999853 22333333
Q ss_pred CCEEEEEeCCCC----c---C---------CccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCC
Q 002446 163 RPLLVFCADGSR----S---C---------GTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRS 226 (921)
Q Consensus 163 rPLLAvv~~g~~----~---g---------~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s 226 (921)
|+++-.-.-.+. . . ..-++|+.-..++| ..+.|.|...+|++.+++++.++
T Consensus 279 rky~ysyDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G-------------~~G~I~lLhakT~eli~s~KieG 345 (514)
T KOG2055|consen 279 RKYLYSYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAG-------------NNGHIHLLHAKTKELITSFKIEG 345 (514)
T ss_pred ceEEEEeeccccccccccCCCCcccchhheeEecCCCCeEEEcc-------------cCceEEeehhhhhhhhheeeecc
Confidence 333322211000 0 0 00001111111111 12679999999999999999999
Q ss_pred CEEEEEEc---CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccccee--ecCceEEecCCCceecCC
Q 002446 227 PIYSVRCS---SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLA--VGPRWLAYSGSPVVVSND 301 (921)
Q Consensus 227 ~V~sV~~S---~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piA--lgpRwLAyas~~~~~s~~ 301 (921)
.|.++.|+ +++++++..++|++||+++..+++......... ...++ +.++|||
T Consensus 346 ~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D~G~v~-----------gts~~~S~ng~ylA----------- 403 (514)
T KOG2055|consen 346 VVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVDDGSVH-----------GTSLCISLNGSYLA----------- 403 (514)
T ss_pred EEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEeecCccc-----------eeeeeecCCCceEE-----------
Confidence 99999996 456777888999999999999888876531111 01122 1122222
Q ss_pred CccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccC
Q 002446 302 GRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNG 381 (921)
Q Consensus 302 GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g 381 (921)
T Consensus 404 -------------------------------------------------------------------------------- 403 (514)
T KOG2055|consen 404 -------------------------------------------------------------------------------- 403 (514)
T ss_pred --------------------------------------------------------------------------------
Confidence
Q ss_pred cccccCCCCEEEEEECC------CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCC-EEEEEeCCCCCCCCCCccCCC
Q 002446 382 HFPDADNVGMVIVRDIV------SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGH-NINIFKIIPGILGTSSACDAG 454 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~------s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt-~IrIWdi~~g~~~~~s~~~~~ 454 (921)
.+...|.|.|||.. +.+++..+..-+..|+.|+|+||+++||.||.... .+|+-.+..- .
T Consensus 404 ---~GS~~GiVNIYd~~s~~~s~~PkPik~~dNLtt~Itsl~Fn~d~qiLAiaS~~~knalrLVHvPS~-T--------- 470 (514)
T KOG2055|consen 404 ---TGSDSGIVNIYDGNSCFASTNPKPIKTVDNLTTAITSLQFNHDAQILAIASRVKKNALRLVHVPSC-T--------- 470 (514)
T ss_pred ---eccCcceEEEeccchhhccCCCCchhhhhhhheeeeeeeeCcchhhhhhhhhccccceEEEeccce-e---------
Confidence 23445778888754 35678888888899999999999999999997432 3666655432 0
Q ss_pred CceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 455 TSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 455 ~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
+-.-+-. ++..-..|+|++|||.|-|||.|..+|.++||.|+.|
T Consensus 471 --VFsNfP~-~n~~vg~vtc~aFSP~sG~lAvGNe~grv~l~kL~hy 514 (514)
T KOG2055|consen 471 --VFSNFPT-SNTKVGHVTCMAFSPNSGYLAVGNEAGRVHLFKLHHY 514 (514)
T ss_pred --eeccCCC-CCCcccceEEEEecCCCceEEeecCCCceeeEeeccC
Confidence 0000000 1222234999999999999999999999999999754
No 59
>PTZ00420 coronin; Provisional
Probab=99.60 E-value=5.4e-13 Score=158.14 Aligned_cols=220 Identities=10% Similarity=0.101 Sum_probs=146.6
Q ss_pred cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcC
Q 002446 117 GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYH 196 (921)
Q Consensus 117 GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h 196 (921)
-+++|+.... .....+..|.++|.++++.|.. ..+||.++. |
T Consensus 55 vI~L~~~~r~-~~v~~L~gH~~~V~~lafsP~~-------------~~lLASgS~----------D-------------- 96 (568)
T PTZ00420 55 AIRLENQMRK-PPVIKLKGHTSSILDLQFNPCF-------------SEILASGSE----------D-------------- 96 (568)
T ss_pred EEEeeecCCC-ceEEEEcCCCCCEEEEEEcCCC-------------CCEEEEEeC----------C--------------
Confidence 3688887653 3344567799999999998631 245665542 2
Q ss_pred CCCCCCCCCcEEEEEECCCCc--------EEEEEe-CCCCEEEEEEcC---CEEEE-EeCCEEEEEECCCCcEEEEEecC
Q 002446 197 DLGNGSSVPTVVHFYSLRSQS--------YVHMLK-FRSPIYSVRCSS---RVVAI-CQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 197 ~~g~~~~~~~tVrIWDL~Tg~--------~V~tL~-f~s~V~sV~~S~---riLAV-a~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
++|+|||+.++. .+..+. +...|..|+|++ .+||+ +.|++|+|||+.+++....+. +
T Consensus 97 ---------gtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~~i~-~ 166 (568)
T PTZ00420 97 ---------LTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAFQIN-M 166 (568)
T ss_pred ---------CeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEEEEe-c
Confidence 789999998753 233444 467899999974 34555 678999999999998776654 2
Q ss_pred CCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEec
Q 002446 264 PIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNL 343 (921)
Q Consensus 264 p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~l 343 (921)
+. .+ ..+++. |. |.
T Consensus 167 ~~---------------~V----~Slsws-------------pd--------------G~-------------------- 180 (568)
T PTZ00420 167 PK---------------KL----SSLKWN-------------IK--------------GN-------------------- 180 (568)
T ss_pred CC---------------cE----EEEEEC-------------CC--------------CC--------------------
Confidence 11 01 112332 00 11
Q ss_pred CCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEE-----EEE
Q 002446 344 GDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISA-----LCF 418 (921)
Q Consensus 344 Gd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsa-----LaF 418 (921)
.++.+..++.|+|||+.+++.+.++.+|.+.+.+ ..|
T Consensus 181 --------------------------------------lLat~s~D~~IrIwD~Rsg~~i~tl~gH~g~~~s~~v~~~~f 222 (568)
T PTZ00420 181 --------------------------------------LLSGTCVGKHMHIIDPRKQEIASSFHIHDGGKNTKNIWIDGL 222 (568)
T ss_pred --------------------------------------EEEEEecCCEEEEEECCCCcEEEEEecccCCceeEEEEeeeE
Confidence 1122345789999999999999999999986543 346
Q ss_pred CCCCCEEEEEecCC---CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEE
Q 002446 419 DPSGILLVTASVQG---HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHL 495 (921)
Q Consensus 419 SPdGtlLATaS~DG---t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhV 495 (921)
++++.+|+|++.++ +.|+|||+... . .......+.. ....+...-++++|.++++|+.|++|++
T Consensus 223 s~d~~~IlTtG~d~~~~R~VkLWDlr~~-~----------~pl~~~~ld~--~~~~L~p~~D~~tg~l~lsGkGD~tIr~ 289 (568)
T PTZ00420 223 GGDDNYILSTGFSKNNMREMKLWDLKNT-T----------SALVTMSIDN--ASAPLIPHYDESTGLIYLIGKGDGNCRY 289 (568)
T ss_pred cCCCCEEEEEEcCCCCccEEEEEECCCC-C----------CceEEEEecC--CccceEEeeeCCCCCEEEEEECCCeEEE
Confidence 79999999988775 24999999853 0 1122223321 1222344444677999999999999999
Q ss_pred EecCCC
Q 002446 496 FAINPL 501 (921)
Q Consensus 496 Wdi~~~ 501 (921)
|++...
T Consensus 290 ~e~~~~ 295 (568)
T PTZ00420 290 YQHSLG 295 (568)
T ss_pred EEccCC
Confidence 999763
No 60
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.59 E-value=1.5e-13 Score=146.81 Aligned_cols=222 Identities=18% Similarity=0.280 Sum_probs=161.8
Q ss_pred CeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 107 RRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 107 ~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
..++.+|.+..+++||+++ |.+.. +|.+--+|+-.++ |. .|.+..+|++.
T Consensus 103 s~i~S~gtDk~v~~wD~~t-G~~~r---k~k~h~~~vNs~~-p~-----------rrg~~lv~Sgs-------------- 152 (338)
T KOG0265|consen 103 SHILSCGTDKTVRGWDAET-GKRIR---KHKGHTSFVNSLD-PS-----------RRGPQLVCSGS-------------- 152 (338)
T ss_pred CEEEEecCCceEEEEeccc-ceeee---hhccccceeeecC-cc-----------ccCCeEEEecC--------------
Confidence 5889999999999999998 44433 3444444444443 32 23444455542
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEEEEeCCEEEEEECCCCcEEEEEecC
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVAICQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLAVa~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
.++++|+||.++.+.++++.-+-++.+|.|+ .+++...-++.|++||++..+.++++.+|
T Consensus 153 -----------------dD~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~lsGh 215 (338)
T KOG0265|consen 153 -----------------DDGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLSGH 215 (338)
T ss_pred -----------------CCceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccCcceEEeecc
Confidence 1289999999999999999888899999995 47777788999999999999999999887
Q ss_pred CCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEec
Q 002446 264 PIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNL 343 (921)
Q Consensus 264 p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~l 343 (921)
.++. .-+++ + | +|+.
T Consensus 216 ~DtI------------t~lsl-------s-------------~--------------~gs~------------------- 230 (338)
T KOG0265|consen 216 ADTI------------TGLSL-------S-------------R--------------YGSF------------------- 230 (338)
T ss_pred cCce------------eeEEe-------c-------------c--------------CCCc-------------------
Confidence 5421 00111 0 0 0100
Q ss_pred CCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC----CceEEEeccCCC----CeEE
Q 002446 344 GDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS----KNVIAQFRAHKS----PISA 415 (921)
Q Consensus 344 Gd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s----~~~l~~~~aH~~----pIsa 415 (921)
+.+-.-+.+|++||+.- .+++..|.+|.. ....
T Consensus 231 ---------------------------------------llsnsMd~tvrvwd~rp~~p~~R~v~if~g~~hnfeknlL~ 271 (338)
T KOG0265|consen 231 ---------------------------------------LLSNSMDNTVRVWDVRPFAPSQRCVKIFQGHIHNFEKNLLK 271 (338)
T ss_pred ---------------------------------------cccccccceEEEEEecccCCCCceEEEeecchhhhhhhcce
Confidence 00112356899999863 456888987754 3445
Q ss_pred EEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEE
Q 002446 416 LCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHL 495 (921)
Q Consensus 416 LaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhV 495 (921)
.++||+++.+..+|.|.. +.|||.... ..+|+| -||.. .|.+++|.|.-.+|.++++|.||.+
T Consensus 272 cswsp~~~~i~ags~dr~-vyvwd~~~r--------------~~lykl-pGh~g-svn~~~Fhp~e~iils~~sdk~i~l 334 (338)
T KOG0265|consen 272 CSWSPNGTKITAGSADRF-VYVWDTTSR--------------RILYKL-PGHYG-SVNEVDFHPTEPIILSCSSDKTIYL 334 (338)
T ss_pred eeccCCCCccccccccce-EEEeecccc--------------cEEEEc-CCcce-eEEEeeecCCCcEEEEeccCceeEe
Confidence 789999999999999964 899998763 567888 46654 4999999999999999999999987
Q ss_pred E
Q 002446 496 F 496 (921)
Q Consensus 496 W 496 (921)
=
T Consensus 335 g 335 (338)
T KOG0265|consen 335 G 335 (338)
T ss_pred e
Confidence 3
No 61
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.59 E-value=3.2e-13 Score=152.40 Aligned_cols=108 Identities=19% Similarity=0.254 Sum_probs=91.4
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+++..|+.|.+|+-.-.+-..+++.|..=|.|+.|||||.++||++.||+ |.|||-.++ ..+..|
T Consensus 164 ~T~sdDn~v~ffeGPPFKFk~s~r~HskFV~~VRysPDG~~Fat~gsDgk-i~iyDGktg--------------e~vg~l 228 (603)
T KOG0318|consen 164 ATGSDDNTVAFFEGPPFKFKSSFREHSKFVNCVRYSPDGSRFATAGSDGK-IYIYDGKTG--------------EKVGEL 228 (603)
T ss_pred EeccCCCeEEEeeCCCeeeeecccccccceeeEEECCCCCeEEEecCCcc-EEEEcCCCc--------------cEEEEe
Confidence 45677889999987777778899999999999999999999999999998 899998876 456666
Q ss_pred e--cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 464 Q--RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 464 ~--RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
. .+|. ..|+.|+||||++.|+++|.|.|++|||+++.....++
T Consensus 229 ~~~~aHk-GsIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~ 273 (603)
T KOG0318|consen 229 EDSDAHK-GSIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTW 273 (603)
T ss_pred cCCCCcc-ccEEEEEECCCCceEEEecCCceEEEEEeeccceEEEe
Confidence 4 1322 34999999999999999999999999999987555444
No 62
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.58 E-value=1.7e-14 Score=158.94 Aligned_cols=253 Identities=11% Similarity=0.120 Sum_probs=177.6
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCC-CeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEAD-NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~-~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
..+.|..+|.-+.|-. +.+ .+..-|.+.-+++|++.... +....++...|++..+.+=+.
T Consensus 170 ~ld~h~gev~~v~~l~---~sd---tlatgg~Dr~Ik~W~v~~~k~~~~~tLaGs~g~it~~d~d~~------------- 230 (459)
T KOG0288|consen 170 VLDAHEGEVHDVEFLR---NSD---TLATGGSDRIIKLWNVLGEKSELISTLAGSLGNITSIDFDSD------------- 230 (459)
T ss_pred hhhccccccceeEEcc---Ccc---hhhhcchhhhhhhhhcccchhhhhhhhhccCCCcceeeecCC-------------
Confidence 3456677777888866 322 56677778889999998632 133345556677777766321
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC---CE
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS---RV 237 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~---ri 237 (921)
.+-.||.. .++.+++|++.+.+..++|.. ...|.++.|.. ++
T Consensus 231 ~~~~iAas----------------------------------~d~~~r~Wnvd~~r~~~TLsGHtdkVt~ak~~~~~~~v 276 (459)
T KOG0288|consen 231 NKHVIAAS----------------------------------NDKNLRLWNVDSLRLRHTLSGHTDKVTAAKFKLSHSRV 276 (459)
T ss_pred CceEEeec----------------------------------CCCceeeeeccchhhhhhhcccccceeeehhhccccce
Confidence 11233211 125699999999999999985 56999999952 33
Q ss_pred EEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccc
Q 002446 238 VAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSG 317 (921)
Q Consensus 238 LAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~ 317 (921)
|-.+.|.+|++||+....|..++..-.. .+.|.++ +
T Consensus 277 Vsgs~DRtiK~WDl~k~~C~kt~l~~S~-------------cnDI~~~---------------------~---------- 312 (459)
T KOG0288|consen 277 VSGSADRTIKLWDLQKAYCSKTVLPGSQ-------------CNDIVCS---------------------I---------- 312 (459)
T ss_pred eeccccchhhhhhhhhhheecccccccc-------------ccceEec---------------------c----------
Confidence 3337788999999998776655432110 1111110 0
Q ss_pred ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEEC
Q 002446 318 FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDI 397 (921)
Q Consensus 318 ~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl 397 (921)
-.+.++..+++|+.||+
T Consensus 313 ---------------------------------------------------------------~~~~SgH~DkkvRfwD~ 329 (459)
T KOG0288|consen 313 ---------------------------------------------------------------SDVISGHFDKKVRFWDI 329 (459)
T ss_pred ---------------------------------------------------------------eeeeecccccceEEEec
Confidence 01123456788999999
Q ss_pred CCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE
Q 002446 398 VSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF 477 (921)
Q Consensus 398 ~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF 477 (921)
.+..+......|. .|++|..+++|..|.+++.|.+ ++++|+.+. ...+.|.-.--.+...++.+.|
T Consensus 330 Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssRDdt-l~viDlRt~------------eI~~~~sA~g~k~asDwtrvvf 395 (459)
T KOG0288|consen 330 RSADKTRSVPLGG-RVTSLDLSMDGLELLSSSRDDT-LKVIDLRTK------------EIRQTFSAEGFKCASDWTRVVF 395 (459)
T ss_pred cCCceeeEeecCc-ceeeEeeccCCeEEeeecCCCc-eeeeecccc------------cEEEEeeccccccccccceeEE
Confidence 9999999999886 9999999999999999999976 899999875 2344443321122334889999
Q ss_pred ccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 478 SDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
|||+.|+|+||.||.|+||++.+++....+..
T Consensus 396 Spd~~YvaAGS~dgsv~iW~v~tgKlE~~l~~ 427 (459)
T KOG0288|consen 396 SPDGSYVAAGSADGSVYIWSVFTGKLEKVLSL 427 (459)
T ss_pred CCCCceeeeccCCCcEEEEEccCceEEEEecc
Confidence 99999999999999999999998877666644
No 63
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.57 E-value=6.3e-14 Score=146.89 Aligned_cols=231 Identities=15% Similarity=0.220 Sum_probs=161.3
Q ss_pred cCcEEEEEccCCCCeEEeeee-ecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCC
Q 002446 115 RSGFQVWDVEEADNVHDLVSR-YDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSA 193 (921)
Q Consensus 115 ~~GfqVWDv~~~~~~~elvS~-~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~ 193 (921)
.+.+-|.++++...++|..+- ....+..++..++. +.-+++.++|
T Consensus 37 ~G~L~ile~~~~~gi~e~~s~d~~D~LfdV~Wse~~------------e~~~~~a~GD---------------------- 82 (311)
T KOG0277|consen 37 NGRLFILEVTDPKGIQECQSYDTEDGLFDVAWSENH------------ENQVIAASGD---------------------- 82 (311)
T ss_pred CceEEEEecCCCCCeEEEEeeecccceeEeeecCCC------------cceEEEEecC----------------------
Confidence 445778888766778887763 45677888887642 2234454444
Q ss_pred CcCCCCCCCCCCcEEEEEECCC-CcEEEEEe-CCCCEEEEEEc---CCE-EEEEeCCEEEEEECCCCcEEEEEecCCCcc
Q 002446 194 NYHDLGNGSSVPTVVHFYSLRS-QSYVHMLK-FRSPIYSVRCS---SRV-VAICQAAQVHCFDAATLEIEYAILTNPIVM 267 (921)
Q Consensus 194 ~~h~~g~~~~~~~tVrIWDL~T-g~~V~tL~-f~s~V~sV~~S---~ri-LAVa~d~~I~IwDl~T~~~l~tL~t~p~~~ 267 (921)
+++||||+.- ...++.++ +...|++|.++ ++. |..+-|++|++||..-.+-+.|..+|.+
T Consensus 83 ------------GSLrl~d~~~~s~Pi~~~kEH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~Tf~gh~~-- 148 (311)
T KOG0277|consen 83 ------------GSLRLFDLTMPSKPIHKFKEHKREVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQTFNGHNS-- 148 (311)
T ss_pred ------------ceEEEeccCCCCcchhHHHhhhhheEEeccccccceeEEeeccCCceEeecCCCCcceEeecCCcc--
Confidence 4599999643 24566654 57899999997 333 4447899999999988777777665421
Q ss_pred CCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCcc
Q 002446 268 GHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLG 347 (921)
Q Consensus 268 g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g 347 (921)
+.|.. .+ +|.
T Consensus 149 ---------------------~Iy~a----~~-----sp~---------------------------------------- 158 (311)
T KOG0277|consen 149 ---------------------CIYQA----AF-----SPH---------------------------------------- 158 (311)
T ss_pred ---------------------EEEEE----ec-----CCC----------------------------------------
Confidence 12220 00 010
Q ss_pred ccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC-CCCEEE
Q 002446 348 YKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP-SGILLV 426 (921)
Q Consensus 348 ~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP-dGtlLA 426 (921)
..+.++++..+|+.++||++....-..|.+|...|.|+.|+. +-.+||
T Consensus 159 -------------------------------~~nlfas~Sgd~~l~lwdvr~~gk~~~i~ah~~Eil~cdw~ky~~~vl~ 207 (311)
T KOG0277|consen 159 -------------------------------IPNLFASASGDGTLRLWDVRSPGKFMSIEAHNSEILCCDWSKYNHNVLA 207 (311)
T ss_pred -------------------------------CCCeEEEccCCceEEEEEecCCCceeEEEeccceeEeecccccCCcEEE
Confidence 001234456689999999986443344999999999999998 677999
Q ss_pred EEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC-CCEEEEEeCCCcEEEEecCCCCCce
Q 002446 427 TASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD-SNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 427 TaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD-g~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
|++.|+. ||+||+..- ..++.+| .||.-| |..|+|||- ...||++|-|.|++|||........
T Consensus 208 Tg~vd~~-vr~wDir~~-------------r~pl~eL-~gh~~A-VRkvk~Sph~~~lLaSasYDmT~riw~~~~~ds~~ 271 (311)
T KOG0277|consen 208 TGGVDNL-VRGWDIRNL-------------RTPLFEL-NGHGLA-VRKVKFSPHHASLLASASYDMTVRIWDPERQDSAI 271 (311)
T ss_pred ecCCCce-EEEEehhhc-------------cccceee-cCCceE-EEEEecCcchhhHhhhccccceEEecccccchhhh
Confidence 9999985 999999874 2456777 566655 999999995 5689999999999999998554443
Q ss_pred -eecCC
Q 002446 506 -NFQPT 510 (921)
Q Consensus 506 -~l~~H 510 (921)
+..-|
T Consensus 272 e~~~~H 277 (311)
T KOG0277|consen 272 ETVDHH 277 (311)
T ss_pred hhhhcc
Confidence 44444
No 64
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.57 E-value=6.2e-14 Score=156.13 Aligned_cols=107 Identities=14% Similarity=0.309 Sum_probs=88.8
Q ss_pred ccccCCCCEEEEEECC--CCceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 383 FPDADNVGMVIVRDIV--SKNVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~--s~~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
|.+.+.++.+.|||++ +.++....++|+.+|.|++|+| ++.+|||||.|+| +++||+..- ...
T Consensus 243 F~sv~dd~~L~iwD~R~~~~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~S~D~t-V~LwDlRnL-------------~~~ 308 (422)
T KOG0264|consen 243 FGSVGDDGKLMIWDTRSNTSKPSHSVKAHSAEVNCVAFNPFNEFILATGSADKT-VALWDLRNL-------------NKP 308 (422)
T ss_pred heeecCCCeEEEEEcCCCCCCCcccccccCCceeEEEeCCCCCceEEeccCCCc-EEEeechhc-------------ccC
Confidence 4456778999999999 5667778889999999999999 6789999999998 899999874 235
Q ss_pred EEEEecccccccEEEEEEccC-CCEEEEEeCCCcEEEEecCCCCCce
Q 002446 460 LYRLQRGLTNAVIQDISFSDD-SNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPD-g~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
++++. ||. ..|..|.|||+ ...||+++.|+.++|||+..-++..
T Consensus 309 lh~~e-~H~-dev~~V~WSPh~etvLASSg~D~rl~vWDls~ig~eq 353 (422)
T KOG0264|consen 309 LHTFE-GHE-DEVFQVEWSPHNETVLASSGTDRRLNVWDLSRIGEEQ 353 (422)
T ss_pred ceecc-CCC-cceEEEEeCCCCCceeEecccCCcEEEEecccccccc
Confidence 66763 543 45999999995 5688999999999999998866654
No 65
>PTZ00420 coronin; Provisional
Probab=99.56 E-value=1.8e-12 Score=153.69 Aligned_cols=127 Identities=13% Similarity=0.270 Sum_probs=95.5
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCC-------eEEeeeeecCCEEEEEEecCCCCCcccc
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADN-------VHDLVSRYDGPVSFMQMLPRPITSKRSR 156 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~-------~~elvS~~dG~Vr~v~~lP~P~~~~~~~ 156 (921)
.+|++.|..+.|+. +. ..+|+.|. ++.++|||+.+.+. ....+..|.+.|.++.+.|..
T Consensus 71 ~gH~~~V~~lafsP---~~---~~lLASgS~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g------- 137 (568)
T PTZ00420 71 KGHTSSILDLQFNP---CF---SEILASGSEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMN------- 137 (568)
T ss_pred cCCCCCEEEEEEcC---CC---CCEEEEEeCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCC-------
Confidence 46899999999987 42 13555555 66689999976332 122456788999999997731
Q ss_pred CccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--
Q 002446 157 DKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS-- 234 (921)
Q Consensus 157 d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S-- 234 (921)
..+|+.++. | ++|+|||+++++.+..+.+...|.++.|+
T Consensus 138 ------~~iLaSgS~----------D-----------------------gtIrIWDl~tg~~~~~i~~~~~V~Slswspd 178 (568)
T PTZ00420 138 ------YYIMCSSGF----------D-----------------------SFVNIWDIENEKRAFQINMPKKLSSLKWNIK 178 (568)
T ss_pred ------CeEEEEEeC----------C-----------------------CeEEEEECCCCcEEEEEecCCcEEEEEECCC
Confidence 123443332 2 67999999999999888888899999996
Q ss_pred CCEEEE-EeCCEEEEEECCCCcEEEEEecC
Q 002446 235 SRVVAI-CQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 235 ~riLAV-a~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
+++|++ +.+++|+|||+++++.+.++..|
T Consensus 179 G~lLat~s~D~~IrIwD~Rsg~~i~tl~gH 208 (568)
T PTZ00420 179 GNLLSGTCVGKHMHIIDPRKQEIASSFHIH 208 (568)
T ss_pred CCEEEEEecCCEEEEEECCCCcEEEEEecc
Confidence 578876 56889999999999988888766
No 66
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.56 E-value=1.6e-12 Score=152.81 Aligned_cols=119 Identities=22% Similarity=0.285 Sum_probs=89.3
Q ss_pred CCCCEEEEEECCCCceEEEe---ccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC------CCCCcc------
Q 002446 387 DNVGMVIVRDIVSKNVIAQF---RAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL------GTSSAC------ 451 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~---~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~------~~~s~~------ 451 (921)
...|+|.+|++++|-....| ++|..+|+.|+.+--++++++|+.+|. ++.||...... +++...
T Consensus 467 ~S~G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~D~~n~~~vsa~~~Gi-lkfw~f~~k~l~~~l~l~~~~~~iv~hr~ 545 (910)
T KOG1539|consen 467 YSKGTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAVDGTNRLLVSAGADGI-LKFWDFKKKVLKKSLRLGSSITGIVYHRV 545 (910)
T ss_pred ccCCeEEEEEcccCeeecccccCccccCceeEEEecCCCceEEEccCcce-EEEEecCCcceeeeeccCCCcceeeeeeh
Confidence 34689999999999988888 699999999999999999999999996 89999987521 111000
Q ss_pred ------CCCCceeEEE--------EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 452 ------DAGTSYVHLY--------RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 452 ------~~~~~~~~l~--------~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
.-..-...++ +-.+||+ .+|++++|||||+||+++++|+||++||+.+....-.+
T Consensus 546 s~l~a~~~ddf~I~vvD~~t~kvvR~f~gh~-nritd~~FS~DgrWlisasmD~tIr~wDlpt~~lID~~ 614 (910)
T KOG1539|consen 546 SDLLAIALDDFSIRVVDVVTRKVVREFWGHG-NRITDMTFSPDGRWLISASMDSTIRTWDLPTGTLIDGL 614 (910)
T ss_pred hhhhhhhcCceeEEEEEchhhhhhHHhhccc-cceeeeEeCCCCcEEEEeecCCcEEEEeccCcceeeeE
Confidence 0000001111 1125654 57999999999999999999999999999886554444
No 67
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.56 E-value=7.5e-13 Score=155.59 Aligned_cols=101 Identities=21% Similarity=0.349 Sum_probs=85.6
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
.++.+..+-.|+|+|..+.+++..|.+|+..|++++|||||++|++|+-|++ ||+||+.++ .++-
T Consensus 548 l~a~~~ddf~I~vvD~~t~kvvR~f~gh~nritd~~FS~DgrWlisasmD~t-Ir~wDlpt~--------------~lID 612 (910)
T KOG1539|consen 548 LLAIALDDFSIRVVDVVTRKVVREFWGHGNRITDMTFSPDGRWLISASMDST-IRTWDLPTG--------------TLID 612 (910)
T ss_pred hhhhhcCceeEEEEEchhhhhhHHhhccccceeeeEeCCCCcEEEEeecCCc-EEEEeccCc--------------ceee
Confidence 4455566778999999999999999999999999999999999999999998 999999986 2333
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCC-CcEEEEecCC
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSR-GTSHLFAINP 500 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~D-gTVhVWdi~~ 500 (921)
-+. ......+++|||+|.+||++..| .-|.+|.-..
T Consensus 613 ~~~---vd~~~~sls~SPngD~LAT~Hvd~~gIylWsNks 649 (910)
T KOG1539|consen 613 GLL---VDSPCTSLSFSPNGDFLATVHVDQNGIYLWSNKS 649 (910)
T ss_pred eEe---cCCcceeeEECCCCCEEEEEEecCceEEEEEchh
Confidence 332 23458899999999999999998 6799997543
No 68
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.56 E-value=3.2e-13 Score=155.53 Aligned_cols=240 Identities=16% Similarity=0.206 Sum_probs=175.9
Q ss_pred CCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEE
Q 002446 88 HDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLL 166 (921)
Q Consensus 88 kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLL 166 (921)
.+.|+.+.|++ +| ..|++|+.+| ++|||++....++.+...|.+.|.+++.-. .+
T Consensus 217 ~~~vtSv~ws~---~G----~~LavG~~~g~v~iwD~~~~k~~~~~~~~h~~rvg~laW~~-----------------~~ 272 (484)
T KOG0305|consen 217 EELVTSVKWSP---DG----SHLAVGTSDGTVQIWDVKEQKKTRTLRGSHASRVGSLAWNS-----------------SV 272 (484)
T ss_pred CCceEEEEECC---CC----CEEEEeecCCeEEEEehhhccccccccCCcCceeEEEeccC-----------------ce
Confidence 89999999999 77 7999999888 699999986656555555888888887642 23
Q ss_pred EEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEE-Ee-CCCCEEEEEEc--CCEEEE-E
Q 002446 167 VFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHM-LK-FRSPIYSVRCS--SRVVAI-C 241 (921)
Q Consensus 167 Avv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~t-L~-f~s~V~sV~~S--~riLAV-a 241 (921)
..++.. | +.|.++|++..+.... ++ +...|+.++++ .+.+|. .
T Consensus 273 lssGsr---------~-----------------------~~I~~~dvR~~~~~~~~~~~H~qeVCgLkws~d~~~lASGg 320 (484)
T KOG0305|consen 273 LSSGSR---------D-----------------------GKILNHDVRISQHVVSTLQGHRQEVCGLKWSPDGNQLASGG 320 (484)
T ss_pred EEEecC---------C-----------------------CcEEEEEEecchhhhhhhhcccceeeeeEECCCCCeeccCC
Confidence 333321 1 5689999998876555 55 57899999997 588998 7
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
.|+.++|||..+.+.++++..|... + +-||++ |.+
T Consensus 321 nDN~~~Iwd~~~~~p~~~~~~H~aA---------------V----KA~awc-------------P~q------------- 355 (484)
T KOG0305|consen 321 NDNVVFIWDGLSPEPKFTFTEHTAA---------------V----KALAWC-------------PWQ------------- 355 (484)
T ss_pred CccceEeccCCCccccEEEecccee---------------e----eEeeeC-------------CCc-------------
Confidence 8899999999888888888877321 1 123443 110
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
..+ ||. ..+..|+.|++||..+++
T Consensus 356 ~~l-----------LAs---------------------------------------------GGGs~D~~i~fwn~~~g~ 379 (484)
T KOG0305|consen 356 SGL-----------LAT---------------------------------------------GGGSADRCIKFWNTNTGA 379 (484)
T ss_pred cCc-----------eEE---------------------------------------------cCCCcccEEEEEEcCCCc
Confidence 000 110 013457899999999999
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEe-cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTAS-VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS-~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
.+..+... +.|+.|.|++..+-|+++- .-...|.||+..+- ..+..+ -||+ .+|..+++|||
T Consensus 380 ~i~~vdtg-sQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~--------------~~~~~l-~gH~-~RVl~la~SPd 442 (484)
T KOG0305|consen 380 RIDSVDTG-SQVCSLIWSKKYKELLSTHGYSENQITLWKYPSM--------------KLVAEL-LGHT-SRVLYLALSPD 442 (484)
T ss_pred EecccccC-CceeeEEEcCCCCEEEEecCCCCCcEEEEecccc--------------ceeeee-cCCc-ceeEEEEECCC
Confidence 88777644 5799999999987666653 22235999998763 233333 4654 56999999999
Q ss_pred CCEEEEEeCCCcEEEEecCCC
Q 002446 481 SNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~ 501 (921)
|+.+++|+.|.|+++|++-+.
T Consensus 443 g~~i~t~a~DETlrfw~~f~~ 463 (484)
T KOG0305|consen 443 GETIVTGAADETLRFWNLFDE 463 (484)
T ss_pred CCEEEEecccCcEEeccccCC
Confidence 999999999999999999775
No 69
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.55 E-value=1.6e-13 Score=153.83 Aligned_cols=246 Identities=17% Similarity=0.223 Sum_probs=175.8
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
...+.|..++|.+ .. +.=+++...-++|||+...- .+.+.+++=+..|..+.+- ...-|
T Consensus 24 ke~~~vssl~fsp---~~---P~d~aVt~S~rvqly~~~~~-~~~k~~srFk~~v~s~~fR--------------~DG~L 82 (487)
T KOG0310|consen 24 KEHNSVSSLCFSP---KH---PYDFAVTSSVRVQLYSSVTR-SVRKTFSRFKDVVYSVDFR--------------SDGRL 82 (487)
T ss_pred cccCcceeEecCC---CC---CCceEEecccEEEEEecchh-hhhhhHHhhccceeEEEee--------------cCCeE
Confidence 4567799999988 22 34577777899999999873 4566677767777777653 33456
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcC---CEEEEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSS---RVVAIC 241 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~---riLAVa 241 (921)
||+++. + +.|+++|+++...++.++ +..+|..+.|++ .+++.+
T Consensus 83 laaGD~-s--------------------------------G~V~vfD~k~r~iLR~~~ah~apv~~~~f~~~d~t~l~s~ 129 (487)
T KOG0310|consen 83 LAAGDE-S--------------------------------GHVKVFDMKSRVILRQLYAHQAPVHVTKFSPQDNTMLVSG 129 (487)
T ss_pred EEccCC-c--------------------------------CcEEEeccccHHHHHHHhhccCceeEEEecccCCeEEEec
Confidence 654432 2 679999988866666665 467999999973 455554
Q ss_pred -eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 242 -QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 242 -~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
.+..+++||+.+......+.+|.+.. |..++. |.
T Consensus 130 sDd~v~k~~d~s~a~v~~~l~~htDYV-------------------R~g~~~-------------~~------------- 164 (487)
T KOG0310|consen 130 SDDKVVKYWDLSTAYVQAELSGHTDYV-------------------RCGDIS-------------PA------------- 164 (487)
T ss_pred CCCceEEEEEcCCcEEEEEecCCccee-------------------Eeeccc-------------cC-------------
Confidence 45689999999988644666654311 111111 00
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccC-cccccCCCCEEEEEECCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNG-HFPDADNVGMVIVRDIVS 399 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g-~~~s~~~~G~V~IwDl~s 399 (921)
++ .++++++||+|++||+.+
T Consensus 165 -----------------------------------------------------------~~hivvtGsYDg~vrl~DtR~ 185 (487)
T KOG0310|consen 165 -----------------------------------------------------------NDHIVVTGSYDGKVRLWDTRS 185 (487)
T ss_pred -----------------------------------------------------------CCeEEEecCCCceEEEEEecc
Confidence 01 134678999999999998
Q ss_pred C-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEc
Q 002446 400 K-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFS 478 (921)
Q Consensus 400 ~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFS 478 (921)
. ..+.+| .|..||..+.|=|+|.++|||+ |..|+|||+.+| ++.++.+ ..++..|+|+++.
T Consensus 186 ~~~~v~el-nhg~pVe~vl~lpsgs~iasAg--Gn~vkVWDl~~G-------------~qll~~~--~~H~KtVTcL~l~ 247 (487)
T KOG0310|consen 186 LTSRVVEL-NHGCPVESVLALPSGSLIASAG--GNSVKVWDLTTG-------------GQLLTSM--FNHNKTVTCLRLA 247 (487)
T ss_pred CCceeEEe-cCCCceeeEEEcCCCCEEEEcC--CCeEEEEEecCC-------------ceehhhh--hcccceEEEEEee
Confidence 7 444444 5889999999999999999998 557999999976 2333333 2233459999999
Q ss_pred cCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 479 DDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 479 PDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
.|++.|.++|.|+.|+|||+..++-...+
T Consensus 248 s~~~rLlS~sLD~~VKVfd~t~~Kvv~s~ 276 (487)
T KOG0310|consen 248 SDSTRLLSGSLDRHVKVFDTTNYKVVHSW 276 (487)
T ss_pred cCCceEeecccccceEEEEccceEEEEee
Confidence 99999999999999999998887554444
No 70
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.55 E-value=2.7e-12 Score=132.59 Aligned_cols=257 Identities=16% Similarity=0.219 Sum_probs=177.3
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccC--CCCe-EE-eeeeecCCEEEEEEecCCCCCccccCc
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEE--ADNV-HD-LVSRYDGPVSFMQMLPRPITSKRSRDK 158 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~--~~~~-~e-lvS~~dG~Vr~v~~lP~P~~~~~~~d~ 158 (921)
.--||..|.+++|.+ +| .+|+.|.++. +++.-.+. ...+ .+ -++-|||.||.+.++..|...
T Consensus 85 ~khhkgsiyc~~ws~---~g----eliatgsndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~------ 151 (350)
T KOG0641|consen 85 NKHHKGSIYCTAWSP---CG----ELIATGSNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESG------ 151 (350)
T ss_pred ccccCccEEEEEecC---cc----CeEEecCCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcC------
Confidence 345788999999998 56 6899998654 67665443 1111 12 257899999999999776432
Q ss_pred cccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEE-cCC
Q 002446 159 FAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRC-SSR 236 (921)
Q Consensus 159 F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~-S~r 236 (921)
..+|+..+.| +|.|.+-|-.+|+..+.+.. ...|.++-. |+-
T Consensus 152 ----~~il~s~gag--------------------------------dc~iy~tdc~~g~~~~a~sghtghilalyswn~~ 195 (350)
T KOG0641|consen 152 ----GAILASAGAG--------------------------------DCKIYITDCGRGQGFHALSGHTGHILALYSWNGA 195 (350)
T ss_pred ----ceEEEecCCC--------------------------------cceEEEeecCCCCcceeecCCcccEEEEEEecCc
Confidence 2455433321 28899999999999999875 568887755 677
Q ss_pred EEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccc
Q 002446 237 VVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSF 315 (921)
Q Consensus 237 iLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~ 315 (921)
++|. +++.+|++||++-..+..++.+.- .+ +| +....++ -+|.. .+||
T Consensus 196 m~~sgsqdktirfwdlrv~~~v~~l~~~~-----~~-~g--lessava----av~vd-------psgr------------ 244 (350)
T KOG0641|consen 196 MFASGSQDKTIRFWDLRVNSCVNTLDNDF-----HD-GG--LESSAVA----AVAVD-------PSGR------------ 244 (350)
T ss_pred EEEccCCCceEEEEeeeccceeeeccCcc-----cC-CC--cccceeE----EEEEC-------CCcc------------
Confidence 7777 788999999999888877775421 00 00 1111111 00000 0000
Q ss_pred ccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEE
Q 002446 316 SGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVR 395 (921)
Q Consensus 316 ~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~Iw 395 (921)
.++++..+....+|
T Consensus 245 ------------------------------------------------------------------ll~sg~~dssc~ly 258 (350)
T KOG0641|consen 245 ------------------------------------------------------------------LLASGHADSSCMLY 258 (350)
T ss_pred ------------------------------------------------------------------eeeeccCCCceEEE
Confidence 12334556678999
Q ss_pred ECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEE
Q 002446 396 DIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDI 475 (921)
Q Consensus 396 Dl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sI 475 (921)
|+..++.+..|..|+..|.|+.|||...+|.|||.|-. |++-|+.-.. .+.+-.+--+.+..++-.+
T Consensus 259 dirg~r~iq~f~phsadir~vrfsp~a~yllt~syd~~-ikltdlqgdl------------a~el~~~vv~ehkdk~i~~ 325 (350)
T KOG0641|consen 259 DIRGGRMIQRFHPHSADIRCVRFSPGAHYLLTCSYDMK-IKLTDLQGDL------------AHELPIMVVAEHKDKAIQC 325 (350)
T ss_pred EeeCCceeeeeCCCccceeEEEeCCCceEEEEecccce-EEEeecccch------------hhcCceEEEEeccCceEEE
Confidence 99999999999999999999999999999999999975 9999987531 0111111112233345568
Q ss_pred EEccCCCEEEEEeCCCcEEEEecC
Q 002446 476 SFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 476 aFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
-|.|..--|.+.|.|.|+.+|.++
T Consensus 326 rwh~~d~sfisssadkt~tlwa~~ 349 (350)
T KOG0641|consen 326 RWHPQDFSFISSSADKTATLWALN 349 (350)
T ss_pred EecCccceeeeccCcceEEEeccC
Confidence 999999889999999999999875
No 71
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.55 E-value=9.5e-14 Score=167.23 Aligned_cols=169 Identities=12% Similarity=0.185 Sum_probs=126.0
Q ss_pred CCCEEEEEECCC------------CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCC--
Q 002446 388 NVGMVIVRDIVS------------KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDA-- 453 (921)
Q Consensus 388 ~~G~V~IwDl~s------------~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~-- 453 (921)
.||.++||..+. .+.+.++..|.++|+|+.|+|||++||+||+|+ .|-||+-.+. +.++.++.
T Consensus 35 ~d~~~~iW~~~~vl~~~~~~~~~l~k~l~~m~~h~~sv~CVR~S~dG~~lAsGSDD~-~v~iW~~~~~--~~~~~fgs~g 111 (942)
T KOG0973|consen 35 LDGGIVIWSQDPVLDEKEEKNENLPKHLCTMDDHDGSVNCVRFSPDGSYLASGSDDR-LVMIWERAEI--GSGTVFGSTG 111 (942)
T ss_pred ccccceeeccccccchhhhhhcccchhheeeccccCceeEEEECCCCCeEeeccCcc-eEEEeeeccc--CCcccccccc
Confidence 567777998652 356788899999999999999999999999996 5999998852 11111211
Q ss_pred ---CCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCccc--------------
Q 002446 454 ---GTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFTT-------------- 516 (921)
Q Consensus 454 ---~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~~-------------- 516 (921)
..+.+..+...|||. ..|++++||||+.|||++|.|++|+||+..+++....+++|.+.+..
T Consensus 112 ~~~~vE~wk~~~~l~~H~-~DV~Dv~Wsp~~~~lvS~s~DnsViiwn~~tF~~~~vl~~H~s~VKGvs~DP~Gky~ASqs 190 (942)
T KOG0973|consen 112 GAKNVESWKVVSILRGHD-SDVLDVNWSPDDSLLVSVSLDNSVIIWNAKTFELLKVLRGHQSLVKGVSWDPIGKYFASQS 190 (942)
T ss_pred cccccceeeEEEEEecCC-CccceeccCCCccEEEEecccceEEEEccccceeeeeeecccccccceEECCccCeeeeec
Confidence 122333444457864 57999999999999999999999999999999777788898776442
Q ss_pred ----------------------ccCCcCCccccCCCCCCCCCCCCcccccCCC---ceeeeeeeEEecCCCCCCccc
Q 002446 517 ----------------------KHGAMAKSGVRWPPNLGLQMPNQQSLCASGP---PVTLSVVSRIRNGNNGWRGTV 568 (921)
Q Consensus 517 ----------------------~~~~~~~~~~r~~~~s~l~~~~~~~l~~~~~---pv~ls~v~rI~~~~~~w~~~v 568 (921)
|...+..+.|++..|| ||++.|+.+++ |+ +.++.|.+++ |..++
T Consensus 191 dDrtikvwrt~dw~i~k~It~pf~~~~~~T~f~RlSWS----PDG~~las~nA~n~~~--~~~~IieR~t--Wk~~~ 259 (942)
T KOG0973|consen 191 DDRTLKVWRTSDWGIEKSITKPFEESPLTTFFLRLSWS----PDGHHLASPNAVNGGK--STIAIIERGT--WKVDK 259 (942)
T ss_pred CCceEEEEEcccceeeEeeccchhhCCCcceeeecccC----CCcCeecchhhccCCc--ceeEEEecCC--ceeee
Confidence 2234455566666555 99999987764 77 7788888855 97653
No 72
>PTZ00421 coronin; Provisional
Probab=99.55 E-value=2.6e-12 Score=150.81 Aligned_cols=128 Identities=12% Similarity=0.221 Sum_probs=95.5
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCC------CeEEeeeeecCCEEEEEEecCCCCCccccCc
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEAD------NVHDLVSRYDGPVSFMQMLPRPITSKRSRDK 158 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~------~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~ 158 (921)
.+|.+.|..+.|+.. ++ ..++..+.++.++|||+.+.+ +....+..|...|.++++.|..
T Consensus 72 ~GH~~~V~~v~fsP~--d~---~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~--------- 137 (493)
T PTZ00421 72 LGQEGPIIDVAFNPF--DP---QKLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSA--------- 137 (493)
T ss_pred eCCCCCEEEEEEcCC--CC---CEEEEEeCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCC---------
Confidence 468999999999872 22 244445556679999998642 1234466788999999997631
Q ss_pred cccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEc--C
Q 002446 159 FAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--S 235 (921)
Q Consensus 159 F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~ 235 (921)
..+|+.++. | ++|+|||+.+++.+..++ +...|.+|+|+ +
T Consensus 138 ----~~iLaSgs~----------D-----------------------gtVrIWDl~tg~~~~~l~~h~~~V~sla~spdG 180 (493)
T PTZ00421 138 ----MNVLASAGA----------D-----------------------MVVNVWDVERGKAVEVIKCHSDQITSLEWNLDG 180 (493)
T ss_pred ----CCEEEEEeC----------C-----------------------CEEEEEECCCCeEEEEEcCCCCceEEEEEECCC
Confidence 245654442 2 789999999999999887 46789999997 5
Q ss_pred CEEEE-EeCCEEEEEECCCCcEEEEEecC
Q 002446 236 RVVAI-CQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 236 riLAV-a~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
++|++ +.|++|+|||+++++.+.++..|
T Consensus 181 ~lLatgs~Dg~IrIwD~rsg~~v~tl~~H 209 (493)
T PTZ00421 181 SLLCTTSKDKKLNIIDPRDGTIVSSVEAH 209 (493)
T ss_pred CEEEEecCCCEEEEEECCCCcEEEEEecC
Confidence 67766 67899999999999988877655
No 73
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.54 E-value=1.2e-13 Score=162.44 Aligned_cols=202 Identities=14% Similarity=0.198 Sum_probs=149.2
Q ss_pred cEEEEEECCCCcEEEEEe-CCCCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
++|++||.+-+.+++.+. +.++|+.|.|- ..+++. +.|.+|++|+..+-+|+++|.+|-+.
T Consensus 31 G~IQlWDYRM~tli~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL~GHlDY--------------- 95 (1202)
T KOG0292|consen 31 GVIQLWDYRMGTLIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTLLGHLDY--------------- 95 (1202)
T ss_pred ceeeeehhhhhhHHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhhccccce---------------
Confidence 679999999999999874 68999999995 345555 55679999999999999999987431
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
+ |.+.|...- |
T Consensus 96 V----Rt~~FHhey----------P------------------------------------------------------- 106 (1202)
T KOG0292|consen 96 V----RTVFFHHEY----------P------------------------------------------------------- 106 (1202)
T ss_pred e----EEeeccCCC----------c-------------------------------------------------------
Confidence 1 233332100 0
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
-+.++..|.+|+||+.+++++++.+.+|.+-|.|..|.|...++++||-|.| |||||+.
T Consensus 107 --------------------WIlSASDDQTIrIWNwqsr~~iavltGHnHYVMcAqFhptEDlIVSaSLDQT-VRVWDis 165 (1202)
T KOG0292|consen 107 --------------------WILSASDDQTIRIWNWQSRKCIAVLTGHNHYVMCAQFHPTEDLIVSASLDQT-VRVWDIS 165 (1202)
T ss_pred --------------------eEEEccCCCeEEEEeccCCceEEEEecCceEEEeeccCCccceEEEecccce-EEEEeec
Confidence 0123456789999999999999999999999999999999999999999987 9999996
Q ss_pred CCCC-----C--------C---CCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCC--
Q 002446 442 PGIL-----G--------T---SSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGG-- 503 (921)
Q Consensus 442 ~g~~-----~--------~---~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~-- 503 (921)
--.. + . ...++....+ -.+.| .||+.. |+-+||.|.-..|++|++|+-|++|.++..+-
T Consensus 166 GLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaV-VK~VL-EGHDRG-VNwaAfhpTlpliVSG~DDRqVKlWrmnetKaWE 242 (1202)
T KOG0292|consen 166 GLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAV-VKHVL-EGHDRG-VNWAAFHPTLPLIVSGADDRQVKLWRMNETKAWE 242 (1202)
T ss_pred chhccCCCCCCchhhhhccccchhhcCCcCee-eeeee-cccccc-cceEEecCCcceEEecCCcceeeEEEecccccee
Confidence 4211 1 0 0011111121 11333 476654 89999999999999999999999999987543
Q ss_pred ceeecCCCCCcc
Q 002446 504 SVNFQPTDANFT 515 (921)
Q Consensus 504 ~~~l~~H~~~~~ 515 (921)
.-+.++|.+++.
T Consensus 243 vDtcrgH~nnVs 254 (1202)
T KOG0292|consen 243 VDTCRGHYNNVS 254 (1202)
T ss_pred ehhhhcccCCcc
Confidence 224467766654
No 74
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.54 E-value=8.8e-13 Score=141.70 Aligned_cols=97 Identities=21% Similarity=0.292 Sum_probs=66.8
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC----------CCCC---------------c----cC
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL----------GTSS---------------A----CD 452 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~----------~~~s---------------~----~~ 452 (921)
.+..|++|.+.|.++||||+.+.++|+|.||+ +||||+.-.+. ++.+ . .-
T Consensus 270 rvf~LkGH~saV~~~aFsn~S~r~vtvSkDG~-wriwdtdVrY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~ 348 (420)
T KOG2096|consen 270 RVFSLKGHQSAVLAAAFSNSSTRAVTVSKDGK-WRIWDTDVRYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAV 348 (420)
T ss_pred hhheeccchhheeeeeeCCCcceeEEEecCCc-EEEeeccceEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEe
Confidence 34578899999999999999999999999998 89999875311 1000 0 00
Q ss_pred CCCceeEEEEEeccc--------ccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 453 AGTSYVHLYRLQRGL--------TNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 453 ~~~~~~~l~~l~RG~--------t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
..++-.+++.-++|. +...|.+|+|++||+++|+++ |.-++|+.-.+
T Consensus 349 s~gs~l~~~~se~g~~~~~~e~~h~~~Is~is~~~~g~~~atcG-dr~vrv~~ntp 403 (420)
T KOG2096|consen 349 SFGSDLKVFASEDGKDYPELEDIHSTTISSISYSSDGKYIATCG-DRYVRVIRNTP 403 (420)
T ss_pred ecCCceEEEEcccCccchhHHHhhcCceeeEEecCCCcEEeeec-ceeeeeecCCC
Confidence 111223344434442 233599999999999999987 45688876433
No 75
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.53 E-value=6.9e-13 Score=154.41 Aligned_cols=316 Identities=16% Similarity=0.213 Sum_probs=205.1
Q ss_pred HHhhhhcccccCCCCCC--------CCCcceecCCCCchhHHhcceeeecc-CcchhhhhhhhhccccccCCCCCCCCcE
Q 002446 21 FIVRLFSGMRNSTDGPK--------PQNGVVSRSTKSPFRAISSYFRIVSS-GASTVARSAVSVASSIVERDDESSHDQV 91 (921)
Q Consensus 21 ~~~~~~~~~~~~~~~~~--------~~~g~~~~~~~~s~~~~s~~~~~~ss-~~~t~~~~~a~~~~s~~~~~~~~~kd~V 91 (921)
+++.=|+-||..++-|. ..|-++ .|..-+-|+-.+.- +.++. .|.-.+.| +-.+|+..|
T Consensus 309 ~~i~r~~~ir~~~kiks~dv~~~~~~~~~lv------~l~nNtv~~ysl~~s~~~~p---~~~~~~~i---~~~GHR~dV 376 (888)
T KOG0306|consen 309 DEIKRLETIRTSAKIKSFDVTPSGGTENTLV------LLANNTVEWYSLENSGKTSP---EADRTSNI---EIGGHRSDV 376 (888)
T ss_pred HHHHHHHheechhheeEEEEEecCCcceeEE------EeecCceEEEEeccCCCCCc---ccccccee---eeccchhhe
Confidence 34444788887765543 113334 35555556555443 22221 12223333 456899999
Q ss_pred EEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeC
Q 002446 92 LWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCAD 171 (921)
Q Consensus 92 ~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~ 171 (921)
.-.+|.. +. .+++.|..+.++||+.++....+.+ -.+=+-+..|+|. . .++ +.+.
T Consensus 377 Rsl~vS~---d~----~~~~Sga~~SikiWn~~t~kciRTi---~~~y~l~~~Fvpg-------------d-~~I-v~G~ 431 (888)
T KOG0306|consen 377 RSLCVSS---DS----ILLASGAGESIKIWNRDTLKCIRTI---TCGYILASKFVPG-------------D-RYI-VLGT 431 (888)
T ss_pred eEEEeec---Cc----eeeeecCCCcEEEEEccCcceeEEe---ccccEEEEEecCC-------------C-ceE-EEec
Confidence 9999987 54 7888888899999999984333322 2345667777763 1 122 2222
Q ss_pred CCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEc---CCEEEEEeCCEEE
Q 002446 172 GSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCS---SRVVAICQAAQVH 247 (921)
Q Consensus 172 g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S---~riLAVa~d~~I~ 247 (921)
. .+.+.+||+.+...+.+++ +.+.|++|+.+ ..++.++.|++|+
T Consensus 432 k--------------------------------~Gel~vfdlaS~~l~Eti~AHdgaIWsi~~~pD~~g~vT~saDktVk 479 (888)
T KOG0306|consen 432 K--------------------------------NGELQVFDLASASLVETIRAHDGAIWSISLSPDNKGFVTGSADKTVK 479 (888)
T ss_pred c--------------------------------CCceEEEEeehhhhhhhhhccccceeeeeecCCCCceEEecCCcEEE
Confidence 1 1679999999999999998 56899999996 4677778999999
Q ss_pred EEECCCCcEEEEEecCCCccCCCCCCCCCccccceeec-CceEEecCCCceecCCCccCCcccccccccccccCCCccee
Q 002446 248 CFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVG-PRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVA 326 (921)
Q Consensus 248 IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlg-pRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va 326 (921)
+||..-. .. -| +.+ .-.+.+- .|.|-..+.-+-+. ++|+ |++
T Consensus 480 fWdf~l~---~~---~~---gt~--------~k~lsl~~~rtLel~ddvL~v~----~Spd--------------gk~-- 522 (888)
T KOG0306|consen 480 FWDFKLV---VS---VP---GTQ--------KKVLSLKHTRTLELEDDVLCVS----VSPD--------------GKL-- 522 (888)
T ss_pred EEeEEEE---ec---cC---ccc--------ceeeeeccceEEeccccEEEEE----EcCC--------------CcE--
Confidence 9996411 00 00 000 0000000 01111110000000 0011 111
Q ss_pred ehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEe
Q 002446 327 HYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQF 406 (921)
Q Consensus 327 ~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~ 406 (921)
|+ -+--+.+|+||-+++.+..-.+
T Consensus 523 ---------La-----------------------------------------------VsLLdnTVkVyflDtlKFflsL 546 (888)
T KOG0306|consen 523 ---------LA-----------------------------------------------VSLLDNTVKVYFLDTLKFFLSL 546 (888)
T ss_pred ---------EE-----------------------------------------------EEeccCeEEEEEecceeeeeee
Confidence 11 1122568999999999999999
Q ss_pred ccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEE
Q 002446 407 RAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMI 486 (921)
Q Consensus 407 ~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAs 486 (921)
.+|.=||.||..|||+++|+|||.|.+ |+||-+.-| .|+ ..+. +|.. .|.++.|-|+...+.+
T Consensus 547 YGHkLPV~smDIS~DSklivTgSADKn-VKiWGLdFG------------DCH--KS~f-AHdD-Svm~V~F~P~~~~FFt 609 (888)
T KOG0306|consen 547 YGHKLPVLSMDISPDSKLIVTGSADKN-VKIWGLDFG------------DCH--KSFF-AHDD-SVMSVQFLPKTHLFFT 609 (888)
T ss_pred cccccceeEEeccCCcCeEEeccCCCc-eEEeccccc------------hhh--hhhh-cccC-ceeEEEEcccceeEEE
Confidence 999999999999999999999999976 999999876 122 1222 3332 3999999999999999
Q ss_pred EeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 487 SSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 487 gS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
++.|+.|+-||-..+.....+.+|..++-
T Consensus 610 ~gKD~kvKqWDg~kFe~iq~L~~H~~ev~ 638 (888)
T KOG0306|consen 610 CGKDGKVKQWDGEKFEEIQKLDGHHSEVW 638 (888)
T ss_pred ecCcceEEeechhhhhhheeeccchheee
Confidence 99999999999999999999999966543
No 76
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.53 E-value=2.6e-12 Score=135.99 Aligned_cols=205 Identities=19% Similarity=0.270 Sum_probs=152.4
Q ss_pred EeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEE
Q 002446 131 DLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHF 210 (921)
Q Consensus 131 elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrI 210 (921)
..++.|.+.|..+++-|- +..+||.|++ | ++||+
T Consensus 8 ~~~~gh~~r~W~~awhp~-------------~g~ilAscg~----------D-----------------------k~vri 41 (312)
T KOG0645|consen 8 QKLSGHKDRVWSVAWHPG-------------KGVILASCGT----------D-----------------------KAVRI 41 (312)
T ss_pred EeecCCCCcEEEEEeccC-------------CceEEEeecC----------C-----------------------ceEEE
Confidence 456778888998888762 1236776764 2 78999
Q ss_pred EECCCC---cEEEEEe--CCCCEEEEEEc--CCEEEE-EeCCEEEEEECC--CCcEEEEEecCCCccCCCCCCCCCcccc
Q 002446 211 YSLRSQ---SYVHMLK--FRSPIYSVRCS--SRVVAI-CQAAQVHCFDAA--TLEIEYAILTNPIVMGHPSAGGIGIGYG 280 (921)
Q Consensus 211 WDL~Tg---~~V~tL~--f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~--T~~~l~tL~t~p~~~g~p~~~g~~i~~~ 280 (921)
|++..+ .++..|. +...|++|+++ +++||+ ++|.++.||--. +++++.+|++|.+..-+
T Consensus 42 w~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aSFD~t~~Iw~k~~~efecv~~lEGHEnEVK~----------- 110 (312)
T KOG0645|consen 42 WSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASASFDATVVIWKKEDGEFECVATLEGHENEVKC----------- 110 (312)
T ss_pred EecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEeeccceEEEeecCCCceeEEeeeeccccceeE-----------
Confidence 999853 3454553 46799999996 689998 789999999866 56789999988664221
Q ss_pred ceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccC
Q 002446 281 PLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLP 360 (921)
Q Consensus 281 piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p 360 (921)
+ |++. +|.
T Consensus 111 -V-------aws~---------------------------sG~------------------------------------- 118 (312)
T KOG0645|consen 111 -V-------AWSA---------------------------SGN------------------------------------- 118 (312)
T ss_pred -E-------EEcC---------------------------CCC-------------------------------------
Confidence 2 3321 011
Q ss_pred CCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC---ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEE
Q 002446 361 DSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK---NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINI 437 (921)
Q Consensus 361 ~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~---~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrI 437 (921)
.+++...+..|-||.+... .+++.|+.|+.-|-.+.|.|.-.+|+++|.|.| |++
T Consensus 119 ---------------------~LATCSRDKSVWiWe~deddEfec~aVL~~HtqDVK~V~WHPt~dlL~S~SYDnT-Ik~ 176 (312)
T KOG0645|consen 119 ---------------------YLATCSRDKSVWIWEIDEDDEFECIAVLQEHTQDVKHVIWHPTEDLLFSCSYDNT-IKV 176 (312)
T ss_pred ---------------------EEEEeeCCCeEEEEEecCCCcEEEEeeeccccccccEEEEcCCcceeEEeccCCe-EEE
Confidence 0122344567888888743 578899999999999999999999999999987 999
Q ss_pred EeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 438 FKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 438 Wdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
|+-.++ .+ -.++.+| .|++. .|.+++|.|+|..|++++.|+|++||.+.
T Consensus 177 ~~~~~d-------dd----W~c~~tl-~g~~~-TVW~~~F~~~G~rl~s~sdD~tv~Iw~~~ 225 (312)
T KOG0645|consen 177 YRDEDD-------DD----WECVQTL-DGHEN-TVWSLAFDNIGSRLVSCSDDGTVSIWRLY 225 (312)
T ss_pred EeecCC-------CC----eeEEEEe-cCccc-eEEEEEecCCCceEEEecCCcceEeeeec
Confidence 987743 11 2445566 35543 69999999999999999999999999965
No 77
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.53 E-value=6.5e-14 Score=154.14 Aligned_cols=229 Identities=17% Similarity=0.282 Sum_probs=169.5
Q ss_pred eEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 108 RVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 108 ~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
..++.|-.+| +++|+.+- ++++.+-..|+..||++++.|+ ..+| +.|++ |
T Consensus 151 ~wmiSgD~gG~iKyWqpnm-nnVk~~~ahh~eaIRdlafSpn-------DskF-------~t~Sd----------D---- 201 (464)
T KOG0284|consen 151 TWMISGDKGGMIKYWQPNM-NNVKIIQAHHAEAIRDLAFSPN-------DSKF-------LTCSD----------D---- 201 (464)
T ss_pred CEEEEcCCCceEEecccch-hhhHHhhHhhhhhhheeccCCC-------Ccee-------EEecC----------C----
Confidence 7888888777 69999876 4565544555699999999884 2233 33443 2
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCC-CEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEec
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRS-PIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s-~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t 262 (921)
++|+|||..-.+.-..|..++ -|.++.+- .-+||+ +-|+.|++||.++++|+.++..
T Consensus 202 -------------------g~ikiWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl~tlh~ 262 (464)
T KOG0284|consen 202 -------------------GTIKIWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCLATLHG 262 (464)
T ss_pred -------------------CeEEEEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCcchhhhhhh
Confidence 789999999888777776544 78888885 467777 5677999999999999999887
Q ss_pred CCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEe
Q 002446 263 NPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVN 342 (921)
Q Consensus 263 ~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~ 342 (921)
|.+. .+++ -|. |. +
T Consensus 263 HKnt--------------Vl~~-----~f~-------------~n--------------~-------------------- 276 (464)
T KOG0284|consen 263 HKNT--------------VLAV-----KFN-------------PN--------------G-------------------- 276 (464)
T ss_pred ccce--------------EEEE-----EEc-------------CC--------------C--------------------
Confidence 7541 1211 111 00 0
Q ss_pred cCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC-C
Q 002446 343 LGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP-S 421 (921)
Q Consensus 343 lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP-d 421 (921)
+ -+++++.|..++++|+.+.+.+..+++|+..|.+++++| .
T Consensus 277 ----------N----------------------------~Llt~skD~~~kv~DiR~mkEl~~~r~Hkkdv~~~~WhP~~ 318 (464)
T KOG0284|consen 277 ----------N----------------------------WLLTGSKDQSCKVFDIRTMKELFTYRGHKKDVTSLTWHPLN 318 (464)
T ss_pred ----------C----------------------------eeEEccCCceEEEEehhHhHHHHHhhcchhhheeecccccc
Confidence 0 122345567899999999999999999999999999999 5
Q ss_pred CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 422 GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 422 GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
-.+|.+++.||. |..|.+... ..+-.+.-+|.. .|++++|.|=|.+||+||.|.|++.|.-...
T Consensus 319 ~~lftsgg~Dgs-vvh~~v~~~--------------~p~~~i~~AHd~-~iwsl~~hPlGhil~tgsnd~t~rfw~r~rp 382 (464)
T KOG0284|consen 319 ESLFTSGGSDGS-VVHWVVGLE--------------EPLGEIPPAHDG-EIWSLAYHPLGHILATGSNDRTVRFWTRNRP 382 (464)
T ss_pred ccceeeccCCCc-eEEEecccc--------------ccccCCCccccc-ceeeeeccccceeEeecCCCcceeeeccCCC
Confidence 668999999997 889988732 112222233333 3999999999999999999999999988766
Q ss_pred CCc
Q 002446 502 GGS 504 (921)
Q Consensus 502 g~~ 504 (921)
+..
T Consensus 383 ~d~ 385 (464)
T KOG0284|consen 383 GDK 385 (464)
T ss_pred CCc
Confidence 554
No 78
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.52 E-value=1.6e-12 Score=142.46 Aligned_cols=116 Identities=15% Similarity=0.238 Sum_probs=93.0
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
+...|-+|++||+.++..+.++... .++.|+..+|..++||++|.|.+ ||+||-.++ .++ .. ...|
T Consensus 276 S~SwDHTIk~WDletg~~~~~~~~~-ksl~~i~~~~~~~Ll~~gssdr~-irl~DPR~~-~gs--------~v--~~s~- 341 (423)
T KOG0313|consen 276 SVSWDHTIKVWDLETGGLKSTLTTN-KSLNCISYSPLSKLLASGSSDRH-IRLWDPRTG-DGS--------VV--SQSL- 341 (423)
T ss_pred eecccceEEEEEeecccceeeeecC-cceeEeecccccceeeecCCCCc-eeecCCCCC-CCc--------ee--EEee-
Confidence 4567889999999999998888765 48999999999999999999976 999998876 111 11 2344
Q ss_pred cccccccEEEEEEccCCC-EEEEEeCCCcEEEEecCCCC-CceeecCCCCCcc
Q 002446 465 RGLTNAVIQDISFSDDSN-WIMISSSRGTSHLFAINPLG-GSVNFQPTDANFT 515 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~-~LAsgS~DgTVhVWdi~~~g-~~~~l~~H~~~~~ 515 (921)
-||.+ -|..+.|+|... .|+++|.|+|+++||+.... ....+.+|.+-+-
T Consensus 342 ~gH~n-wVssvkwsp~~~~~~~S~S~D~t~klWDvRS~k~plydI~~h~DKvl 393 (423)
T KOG0313|consen 342 IGHKN-WVSSVKWSPTNEFQLVSGSYDNTVKLWDVRSTKAPLYDIAGHNDKVL 393 (423)
T ss_pred ecchh-hhhheecCCCCceEEEEEecCCeEEEEEeccCCCcceeeccCCceEE
Confidence 46655 599999999665 57899999999999999877 5568899965544
No 79
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.52 E-value=6.5e-13 Score=138.09 Aligned_cols=182 Identities=15% Similarity=0.158 Sum_probs=140.5
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEc---CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCS---SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S---~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
.+||+|+...|.++++..- ...|.+++.+ .++-+...|+.|++||+.|++.++.+.+|.. .+|.
T Consensus 39 rtvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~rgH~a------------qVNt 106 (307)
T KOG0316|consen 39 RTVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFRGHLA------------QVNT 106 (307)
T ss_pred ceEEeecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeecccccc------------eeeE
Confidence 8999999999999999986 4589998885 4555557889999999999999999988731 1232
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
+ +|.... .
T Consensus 107 V-------~fNees----------------------------S------------------------------------- 114 (307)
T KOG0316|consen 107 V-------RFNEES----------------------------S------------------------------------- 114 (307)
T ss_pred E-------EecCcc----------------------------e-------------------------------------
Confidence 2 232100 0
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC--ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEe
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK--NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFK 439 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~--~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWd 439 (921)
.++++..|..|++||-.+. ++++.|..-...|.++.. .+..++++|.||+ +|.||
T Consensus 115 --------------------Vv~SgsfD~s~r~wDCRS~s~ePiQildea~D~V~Si~v--~~heIvaGS~DGt-vRtyd 171 (307)
T KOG0316|consen 115 --------------------VVASGSFDSSVRLWDCRSRSFEPIQILDEAKDGVSSIDV--AEHEIVAGSVDGT-VRTYD 171 (307)
T ss_pred --------------------EEEeccccceeEEEEcccCCCCccchhhhhcCceeEEEe--cccEEEeeccCCc-EEEEE
Confidence 0123455678999999864 678888888888988876 4689999999998 89999
Q ss_pred CCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCC
Q 002446 440 IIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDA 512 (921)
Q Consensus 440 i~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~ 512 (921)
+..+ .. .. ..-...|++++||+|++.+.+++.|+|+|+.|-.+++-...+.+|.+
T Consensus 172 iR~G--------------~l-~s---Dy~g~pit~vs~s~d~nc~La~~l~stlrLlDk~tGklL~sYkGhkn 226 (307)
T KOG0316|consen 172 IRKG--------------TL-SS---DYFGHPITSVSFSKDGNCSLASSLDSTLRLLDKETGKLLKSYKGHKN 226 (307)
T ss_pred eecc--------------ee-eh---hhcCCcceeEEecCCCCEEEEeeccceeeecccchhHHHHHhccccc
Confidence 9987 11 11 11223599999999999999999999999999988877778889854
No 80
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.52 E-value=1e-13 Score=155.20 Aligned_cols=237 Identities=15% Similarity=0.215 Sum_probs=160.5
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeee-cCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRY-DGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~-dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+|+..|.-++|++ ++ .++|..+|+..+++||+|+ |.+. .+-+ +..+.|+++-|++ +
T Consensus 256 gH~k~Vrd~~~s~---~g---~~fLS~sfD~~lKlwDtET-G~~~--~~f~~~~~~~cvkf~pd~--------------~ 312 (503)
T KOG0282|consen 256 GHRKPVRDASFNN---CG---TSFLSASFDRFLKLWDTET-GQVL--SRFHLDKVPTCVKFHPDN--------------Q 312 (503)
T ss_pred cchhhhhhhhccc---cC---Ceeeeeecceeeeeecccc-ceEE--EEEecCCCceeeecCCCC--------------C
Confidence 6888899999999 55 4899999999999999999 4443 3333 5567888887752 2
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEE---cCCEEEE
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRC---SSRVVAI 240 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~---S~riLAV 240 (921)
-+.+|++. | +.|+-||+++++.++++.. -+.|.+|.| ++++|..
T Consensus 313 n~fl~G~s---------d-----------------------~ki~~wDiRs~kvvqeYd~hLg~i~~i~F~~~g~rFiss 360 (503)
T KOG0282|consen 313 NIFLVGGS---------D-----------------------KKIRQWDIRSGKVVQEYDRHLGAILDITFVDEGRRFISS 360 (503)
T ss_pred cEEEEecC---------C-----------------------CcEEEEeccchHHHHHHHhhhhheeeeEEccCCceEeee
Confidence 34455531 1 6799999999999988865 478888888 4677777
Q ss_pred EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 241 CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 241 a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
+.++.++||+..+.-.+..+... ....+| .+++.| .
T Consensus 361 SDdks~riWe~~~~v~ik~i~~~-~~hsmP----------~~~~~P--------------------~------------- 396 (503)
T KOG0282|consen 361 SDDKSVRIWENRIPVPIKNIADP-EMHTMP----------CLTLHP--------------------N------------- 396 (503)
T ss_pred ccCccEEEEEcCCCccchhhcch-hhccCc----------ceecCC--------------------C-------------
Confidence 88999999999876544333211 111111 111111 0
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC-
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS- 399 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s- 399 (921)
+.. ++....+..|.|+.+..
T Consensus 397 -~~~----------------------------------------------------------~~aQs~dN~i~ifs~~~~ 417 (503)
T KOG0282|consen 397 -GKW----------------------------------------------------------FAAQSMDNYIAIFSTVPP 417 (503)
T ss_pred -CCe----------------------------------------------------------ehhhccCceEEEEecccc
Confidence 100 00111223444444332
Q ss_pred --CceEEEeccCCC--CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEE
Q 002446 400 --KNVIAQFRAHKS--PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDI 475 (921)
Q Consensus 400 --~~~l~~~~aH~~--pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sI 475 (921)
......|++|.. --..+.|||||.+|++|+.||. +.+||..+. ..+.++ ..++ ..+..+
T Consensus 418 ~r~nkkK~feGh~vaGys~~v~fSpDG~~l~SGdsdG~-v~~wdwkt~--------------kl~~~l-kah~-~~ci~v 480 (503)
T KOG0282|consen 418 FRLNKKKRFEGHSVAGYSCQVDFSPDGRTLCSGDSDGK-VNFWDWKTT--------------KLVSKL-KAHD-QPCIGV 480 (503)
T ss_pred cccCHhhhhcceeccCceeeEEEcCCCCeEEeecCCcc-EEEeechhh--------------hhhhcc-ccCC-cceEEE
Confidence 123457788864 3445899999999999999997 899999974 233333 2333 348899
Q ss_pred EEccC-CCEEEEEeCCCcEEEEe
Q 002446 476 SFSDD-SNWIMISSSRGTSHLFA 497 (921)
Q Consensus 476 aFSPD-g~~LAsgS~DgTVhVWd 497 (921)
.|.|- ..-+|+++-||-|+||+
T Consensus 481 ~wHP~e~Skvat~~w~G~Ikiwd 503 (503)
T KOG0282|consen 481 DWHPVEPSKVATCGWDGLIKIWD 503 (503)
T ss_pred EecCCCcceeEecccCceeEecC
Confidence 99995 45799999999999996
No 81
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.51 E-value=4e-13 Score=148.01 Aligned_cols=281 Identities=16% Similarity=0.239 Sum_probs=176.7
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccC-cEEEEEccCCCCe--EEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRS-GFQVWDVEEADNV--HDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~-GfqVWDv~~~~~~--~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
.+|+|+|=|+.|.. +| +.|+.+..+ ..-||++.....+ ...+-.|..+|.++.++|+
T Consensus 221 ~~htdEVWfl~FS~---nG----kyLAsaSkD~Taiiw~v~~d~~~kl~~tlvgh~~~V~yi~wSPD------------- 280 (519)
T KOG0293|consen 221 QDHTDEVWFLQFSH---NG----KYLASASKDSTAIIWIVVYDVHFKLKKTLVGHSQPVSYIMWSPD------------- 280 (519)
T ss_pred hhCCCcEEEEEEcC---CC----eeEeeccCCceEEEEEEecCcceeeeeeeecccCceEEEEECCC-------------
Confidence 46899999999998 77 799998855 5689999875542 2334568899999999985
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCC--CCEEEEEEc--C-C
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFR--SPIYSVRCS--S-R 236 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~--s~V~sV~~S--~-r 236 (921)
.|-||++..+ ..+++||..||++++.+... -.+.+.++. + +
T Consensus 281 dryLlaCg~~----------------------------------e~~~lwDv~tgd~~~~y~~~~~~S~~sc~W~pDg~~ 326 (519)
T KOG0293|consen 281 DRYLLACGFD----------------------------------EVLSLWDVDTGDLRHLYPSGLGFSVSSCAWCPDGFR 326 (519)
T ss_pred CCeEEecCch----------------------------------HheeeccCCcchhhhhcccCcCCCcceeEEccCCce
Confidence 3445543322 33899999999999988754 466677775 3 5
Q ss_pred EEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC--ceEEecCCCceecCCCccCCcccccccc
Q 002446 237 VVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSPVVVSNDGRVNPQHLMQSRS 314 (921)
Q Consensus 237 iLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~~~~s~~GrvsPq~l~~s~~ 314 (921)
+|+.+.+++|.-||+..-. +...+.--. | .+..+|+.+ .|+-....+
T Consensus 327 ~V~Gs~dr~i~~wdlDgn~-~~~W~gvr~----~-------~v~dlait~Dgk~vl~v~~d------------------- 375 (519)
T KOG0293|consen 327 FVTGSPDRTIIMWDLDGNI-LGNWEGVRD----P-------KVHDLAITYDGKYVLLVTVD------------------- 375 (519)
T ss_pred eEecCCCCcEEEecCCcch-hhccccccc----c-------eeEEEEEcCCCcEEEEEecc-------------------
Confidence 5666889999999987433 222221100 0 112233322 222211110
Q ss_pred cccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEE
Q 002446 315 FSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIV 394 (921)
Q Consensus 315 ~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~I 394 (921)
+.+.-|.+++-- -.|+... + +++++++. .+. +. .+...-.+..|++
T Consensus 376 --------~~i~l~~~e~~~--dr~lise-~---~~its~~i----------------S~d-~k---~~LvnL~~qei~L 421 (519)
T KOG0293|consen 376 --------KKIRLYNREARV--DRGLISE-E---QPITSFSI----------------SKD-GK---LALVNLQDQEIHL 421 (519)
T ss_pred --------cceeeechhhhh--hhccccc-c---CceeEEEE----------------cCC-Cc---EEEEEcccCeeEE
Confidence 000111111000 0000000 0 11111110 000 00 0111124567999
Q ss_pred EECCCCceEEEeccCCCC--eEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccccc
Q 002446 395 RDIVSKNVIAQFRAHKSP--ISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAV 471 (921)
Q Consensus 395 wDl~s~~~l~~~~aH~~p--IsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~ 471 (921)
||++..+.+..+.+|+.. |-.-||-- +.+++|+||+|++ |+||+-..+ ..+.+| .||.. .
T Consensus 422 WDl~e~~lv~kY~Ghkq~~fiIrSCFgg~~~~fiaSGSED~k-vyIWhr~sg--------------kll~~L-sGHs~-~ 484 (519)
T KOG0293|consen 422 WDLEENKLVRKYFGHKQGHFIIRSCFGGGNDKFIASGSEDSK-VYIWHRISG--------------KLLAVL-SGHSK-T 484 (519)
T ss_pred eecchhhHHHHhhcccccceEEEeccCCCCcceEEecCCCce-EEEEEccCC--------------ceeEee-cCCcc-e
Confidence 999999999999999853 55567876 5589999999987 999998876 455566 57764 4
Q ss_pred EEEEEEcc-CCCEEEEEeCCCcEEEEecCCC
Q 002446 472 IQDISFSD-DSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 472 I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|++++|+| |-.+||++|+||||+||...+.
T Consensus 485 vNcVswNP~~p~m~ASasDDgtIRIWg~~~~ 515 (519)
T KOG0293|consen 485 VNCVSWNPADPEMFASASDDGTIRIWGPSDN 515 (519)
T ss_pred eeEEecCCCCHHHhhccCCCCeEEEecCCcc
Confidence 99999999 5678999999999999998765
No 82
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.48 E-value=1.7e-12 Score=135.86 Aligned_cols=103 Identities=16% Similarity=0.202 Sum_probs=83.8
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+++..+.+.|..||..+..+++.++.. ..|.+.+++|+-..++.+..|+. ++.||..++ ..+-.
T Consensus 198 ilTia~gssV~Fwdaksf~~lKs~k~P-~nV~SASL~P~k~~fVaGged~~-~~kfDy~Tg--------------eEi~~ 261 (334)
T KOG0278|consen 198 ILTIAYGSSVKFWDAKSFGLLKSYKMP-CNVESASLHPKKEFFVAGGEDFK-VYKFDYNTG--------------EEIGS 261 (334)
T ss_pred EEEEecCceeEEeccccccceeeccCc-cccccccccCCCceEEecCcceE-EEEEeccCC--------------ceeee
Confidence 344455678999999999988887754 36888999999999999999986 899999987 22222
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
+..|+.. .|.|+.|||||...|+||.||||+||...+..
T Consensus 262 ~nkgh~g-pVhcVrFSPdGE~yAsGSEDGTirlWQt~~~~ 300 (334)
T KOG0278|consen 262 YNKGHFG-PVHCVRFSPDGELYASGSEDGTIRLWQTTPGK 300 (334)
T ss_pred cccCCCC-ceEEEEECCCCceeeccCCCceEEEEEecCCC
Confidence 2356654 59999999999999999999999999997753
No 83
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.48 E-value=1.3e-12 Score=137.20 Aligned_cols=251 Identities=12% Similarity=0.120 Sum_probs=170.1
Q ss_pred CCCCCCCcEEEEEEecccCC------CCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESE------AGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSR 156 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d------~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~ 156 (921)
|.++.+.-....+||.-+.- ...-..+++...++.+||||+..+.+....+..|...|..+..-+.
T Consensus 44 e~~~~~gi~e~~s~d~~D~LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~kEH~~EV~Svdwn~~-------- 115 (311)
T KOG0277|consen 44 EVTDPKGIQECQSYDTEDGLFDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFKEHKREVYSVDWNTV-------- 115 (311)
T ss_pred ecCCCCCeEEEEeeecccceeEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHHhhhhheEEeccccc--------
Confidence 33345666777778772210 0112355555557779999987766665666778778877766431
Q ss_pred CccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEc-
Q 002446 157 DKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCS- 234 (921)
Q Consensus 157 d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S- 234 (921)
+.-..+.+ +| ++|||+||..-++-+++++- .+.||...++
T Consensus 116 ------~r~~~lts-SW-------------------------------D~TiKLW~~~r~~Sv~Tf~gh~~~Iy~a~~sp 157 (311)
T KOG0277|consen 116 ------RRRIFLTS-SW-------------------------------DGTIKLWDPNRPNSVQTFNGHNSCIYQAAFSP 157 (311)
T ss_pred ------cceeEEee-cc-------------------------------CCceEeecCCCCcceEeecCCccEEEEEecCC
Confidence 12222233 44 38899999999999999875 6799999998
Q ss_pred --CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccc
Q 002446 235 --SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQ 311 (921)
Q Consensus 235 --~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~ 311 (921)
++++|. +.|++.++||++..-....++.|... ++.-.|
T Consensus 158 ~~~nlfas~Sgd~~l~lwdvr~~gk~~~i~ah~~E----------------il~cdw----------------------- 198 (311)
T KOG0277|consen 158 HIPNLFASASGDGTLRLWDVRSPGKFMSIEAHNSE----------------ILCCDW----------------------- 198 (311)
T ss_pred CCCCeEEEccCCceEEEEEecCCCceeEEEeccce----------------eEeecc-----------------------
Confidence 477877 77899999998754333334433110 000000
Q ss_pred ccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCE
Q 002446 312 SRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGM 391 (921)
Q Consensus 312 s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~ 391 (921)
++|- ...+++++.++.
T Consensus 199 ----------------------------------------~ky~------------------------~~vl~Tg~vd~~ 214 (311)
T KOG0277|consen 199 ----------------------------------------SKYN------------------------HNVLATGGVDNL 214 (311)
T ss_pred ----------------------------------------cccC------------------------CcEEEecCCCce
Confidence 0010 002345677899
Q ss_pred EEEEECCCC-ceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 392 VIVRDIVSK-NVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 392 V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
|++||+.+. .++..+.+|.-+|..|+|||. ..+||+||.|=| +||||...+ . +....++ ++.
T Consensus 215 vr~wDir~~r~pl~eL~gh~~AVRkvk~Sph~~~lLaSasYDmT-~riw~~~~~-d----------s~~e~~~----~Ht 278 (311)
T KOG0277|consen 215 VRGWDIRNLRTPLFELNGHGLAVRKVKFSPHHASLLASASYDMT-VRIWDPERQ-D----------SAIETVD----HHT 278 (311)
T ss_pred EEEEehhhccccceeecCCceEEEEEecCcchhhHhhhccccce-EEecccccc-h----------hhhhhhh----ccc
Confidence 999999975 578899999999999999996 568999999987 899998854 0 1122222 122
Q ss_pred ccEEEEEEcc-CCCEEEEEeCCCcEEEEec
Q 002446 470 AVIQDISFSD-DSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 470 a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi 498 (921)
.-|..+.||+ +..++|+.+-|.++.||+-
T Consensus 279 EFv~g~Dws~~~~~~vAs~gWDe~l~Vw~p 308 (311)
T KOG0277|consen 279 EFVCGLDWSLFDPGQVASTGWDELLYVWNP 308 (311)
T ss_pred eEEeccccccccCceeeecccccceeeecc
Confidence 3488899987 7889999999999999973
No 84
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.47 E-value=5.9e-12 Score=151.99 Aligned_cols=252 Identities=19% Similarity=0.265 Sum_probs=174.7
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccC------CCC-----------eEEeeeeecCCEEEEEEe
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEE------ADN-----------VHDLVSRYDGPVSFMQML 146 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~------~~~-----------~~elvS~~dG~Vr~v~~l 146 (921)
+.|...|.+++|-+ || ++|+.|.++. ++||.-+. .+. +..++..|++-|..+.+.
T Consensus 66 ~~h~~sv~CVR~S~---dG----~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~DV~Dv~Ws 138 (942)
T KOG0973|consen 66 DDHDGSVNCVRFSP---DG----SYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILRGHDSDVLDVNWS 138 (942)
T ss_pred ccccCceeEEEECC---CC----CeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEecCCCccceeccC
Confidence 45778899999999 88 7999999988 59999983 111 334555678888888887
Q ss_pred cCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-C
Q 002446 147 PRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-R 225 (921)
Q Consensus 147 P~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~ 225 (921)
|+ -.+||.|+- +++|-|||.++.+.++.|+- .
T Consensus 139 p~--------------~~~lvS~s~---------------------------------DnsViiwn~~tF~~~~vl~~H~ 171 (942)
T KOG0973|consen 139 PD--------------DSLLVSVSL---------------------------------DNSVIIWNAKTFELLKVLRGHQ 171 (942)
T ss_pred CC--------------ccEEEEecc---------------------------------cceEEEEccccceeeeeeeccc
Confidence 64 145665552 27899999999999999975 6
Q ss_pred CCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCC
Q 002446 226 SPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDG 302 (921)
Q Consensus 226 s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~G 302 (921)
+.|..|.|. ++++|+ +.|++|+||+..+....+++...-.. ++. + .+ ++=. .|
T Consensus 172 s~VKGvs~DP~Gky~ASqsdDrtikvwrt~dw~i~k~It~pf~~--~~~-------~-T~-----f~Rl------SW--- 227 (942)
T KOG0973|consen 172 SLVKGVSWDPIGKYFASQSDDRTLKVWRTSDWGIEKSITKPFEE--SPL-------T-TF-----FLRL------SW--- 227 (942)
T ss_pred ccccceEECCccCeeeeecCCceEEEEEcccceeeEeeccchhh--CCC-------c-ce-----eeec------cc---
Confidence 899999996 699999 88899999998887776666432100 000 0 00 0000 00
Q ss_pred ccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCc
Q 002446 303 RVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGH 382 (921)
Q Consensus 303 rvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~ 382 (921)
+|+ |.. |++ +.. ++
T Consensus 228 --SPD--------------G~~-----------las------------------------------~nA-------~n-- 241 (942)
T KOG0973|consen 228 --SPD--------------GHH-----------LAS------------------------------PNA-------VN-- 241 (942)
T ss_pred --CCC--------------cCe-----------ecc------------------------------hhh-------cc--
Confidence 011 111 110 000 00
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCC-----CC------------EEEEEecCCCEEEEEeCCCCCC
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPS-----GI------------LLVTASVQGHNINIFKIIPGIL 445 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPd-----Gt------------lLATaS~DGt~IrIWdi~~g~~ 445 (921)
+..-.+.|.+-.+-+.-..|-+|..|+.+++|+|. -+ .+|+||.|++ |-||.....
T Consensus 242 ----~~~~~~~IieR~tWk~~~~LvGH~~p~evvrFnP~lfe~~~~ng~~~~~~~~y~i~AvgSqDrS-lSVW~T~~~-- 314 (942)
T KOG0973|consen 242 ----GGKSTIAIIERGTWKVDKDLVGHSAPVEVVRFNPKLFERNNKNGTSTQPNCYYCIAAVGSQDRS-LSVWNTALP-- 314 (942)
T ss_pred ----CCcceeEEEecCCceeeeeeecCCCceEEEEeChHHhccccccCCccCCCcceEEEEEecCCcc-EEEEecCCC--
Confidence 11235677776677777889999999999999982 11 6899999987 899987543
Q ss_pred CCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 446 GTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 446 ~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
+.+...+. .....|.|++|||||.-|.++|.||||.++..+.
T Consensus 315 ------------RPl~vi~~-lf~~SI~DmsWspdG~~LfacS~DGtV~~i~Fee 356 (942)
T KOG0973|consen 315 ------------RPLFVIHN-LFNKSIVDMSWSPDGFSLFACSLDGTVALIHFEE 356 (942)
T ss_pred ------------Cchhhhhh-hhcCceeeeeEcCCCCeEEEEecCCeEEEEEcch
Confidence 23332221 1234599999999999999999999999998865
No 85
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.47 E-value=3.9e-12 Score=146.72 Aligned_cols=239 Identities=15% Similarity=0.192 Sum_probs=183.9
Q ss_pred CeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 107 RRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 107 ~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
..+|++|....+-+|+-.+ +.+.++++-....|..+.+.++ ...||+...
T Consensus 188 ~n~laValg~~vylW~~~s-~~v~~l~~~~~~~vtSv~ws~~--------------G~~LavG~~--------------- 237 (484)
T KOG0305|consen 188 ANVLAVALGQSVYLWSASS-GSVTELCSFGEELVTSVKWSPD--------------GSHLAVGTS--------------- 237 (484)
T ss_pred CCeEEEEecceEEEEecCC-CceEEeEecCCCceEEEEECCC--------------CCEEEEeec---------------
Confidence 4799999999999999988 6788888877889999988764 245665543
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC--CCCEEEEEEcCCEEEE-EeCCEEEEEECCCCcEEEE-Eec
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF--RSPIYSVRCSSRVVAI-CQAAQVHCFDAATLEIEYA-ILT 262 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f--~s~V~sV~~S~riLAV-a~d~~I~IwDl~T~~~l~t-L~t 262 (921)
.++|.|||.++.+.+.++.. ...|-+++++..++.. ..++.|..+|++..+.... +..
T Consensus 238 ------------------~g~v~iwD~~~~k~~~~~~~~h~~rvg~laW~~~~lssGsr~~~I~~~dvR~~~~~~~~~~~ 299 (484)
T KOG0305|consen 238 ------------------DGTVQIWDVKEQKKTRTLRGSHASRVGSLAWNSSVLSSGSRDGKILNHDVRISQHVVSTLQG 299 (484)
T ss_pred ------------------CCeEEEEehhhccccccccCCcCceeEEEeccCceEEEecCCCcEEEEEEecchhhhhhhhc
Confidence 16799999999999999887 6789999999877776 6788999999988764333 222
Q ss_pred CCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEe
Q 002446 263 NPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVN 342 (921)
Q Consensus 263 ~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~ 342 (921)
|.. -+.|+.+
T Consensus 300 H~q----------------------------------------------------------------------eVCgLkw 309 (484)
T KOG0305|consen 300 HRQ----------------------------------------------------------------------EVCGLKW 309 (484)
T ss_pred ccc----------------------------------------------------------------------eeeeeEE
Confidence 211 0112221
Q ss_pred cCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC-C
Q 002446 343 LGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP-S 421 (921)
Q Consensus 343 lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP-d 421 (921)
--|. ..++++++|..|.|||.....++.++..|+.+|-+|+|+| .
T Consensus 310 s~d~----------------------------------~~lASGgnDN~~~Iwd~~~~~p~~~~~~H~aAVKA~awcP~q 355 (484)
T KOG0305|consen 310 SPDG----------------------------------NQLASGGNDNVVFIWDGLSPEPKFTFTEHTAAVKALAWCPWQ 355 (484)
T ss_pred CCCC----------------------------------CeeccCCCccceEeccCCCccccEEEeccceeeeEeeeCCCc
Confidence 1111 1234567889999999999999999999999999999999 6
Q ss_pred CCEEEEEe--cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEE--EeCCCcEEEEe
Q 002446 422 GILLVTAS--VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMI--SSSRGTSHLFA 497 (921)
Q Consensus 422 GtlLATaS--~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAs--gS~DgTVhVWd 497 (921)
..+||||+ .|++ |++||+.++ ..+..+ .+.+.|.+|.||+..+-|++ |-.++-|.||+
T Consensus 356 ~~lLAsGGGs~D~~-i~fwn~~~g--------------~~i~~v---dtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~ 417 (484)
T KOG0305|consen 356 SGLLATGGGSADRC-IKFWNTNTG--------------ARIDSV---DTGSQVCSLIWSKKYKELLSTHGYSENQITLWK 417 (484)
T ss_pred cCceEEcCCCcccE-EEEEEcCCC--------------cEeccc---ccCCceeeEEEcCCCCEEEEecCCCCCcEEEEe
Confidence 77999974 5765 999999986 333333 35567999999999876665 45677899999
Q ss_pred cCCCCCceeecCCCCCcc
Q 002446 498 INPLGGSVNFQPTDANFT 515 (921)
Q Consensus 498 i~~~g~~~~l~~H~~~~~ 515 (921)
+.+......+.+|...+-
T Consensus 418 ~ps~~~~~~l~gH~~RVl 435 (484)
T KOG0305|consen 418 YPSMKLVAELLGHTSRVL 435 (484)
T ss_pred ccccceeeeecCCcceeE
Confidence 999888889999976544
No 86
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.46 E-value=2.9e-13 Score=158.01 Aligned_cols=113 Identities=15% Similarity=0.261 Sum_probs=89.1
Q ss_pred CCCCEEEEEECCC-CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 387 DNVGMVIVRDIVS-KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 387 ~~~G~V~IwDl~s-~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
...|.+++||+.. .++...|.||.+||.|+.++|++.+||||+.|++ |+|||...+ ....+.+.
T Consensus 196 ~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhPnr~~lATGGRDK~-vkiWd~t~~------------~~~~~~tI-- 260 (839)
T KOG0269|consen 196 HDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHPNREWLATGGRDKM-VKIWDMTDS------------RAKPKHTI-- 260 (839)
T ss_pred cCCceEEEeeccCchhHHHHhhcccCceEEEeecCCCceeeecCCCcc-EEEEeccCC------------CccceeEE--
Confidence 4458899999975 4567788899999999999999999999999986 999998864 11223344
Q ss_pred ccccccEEEEEEccCCCE-EEEEeC--CCcEEEEecC-CCCCceeecCCCCCcc
Q 002446 466 GLTNAVIQDISFSDDSNW-IMISSS--RGTSHLFAIN-PLGGSVNFQPTDANFT 515 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~-LAsgS~--DgTVhVWdi~-~~g~~~~l~~H~~~~~ 515 (921)
.|.+.|..|.|-|+-++ ||++++ |-.|||||+. ||-.-.++..|.+.+.
T Consensus 261 -nTiapv~rVkWRP~~~~hLAtcsmv~dtsV~VWDvrRPYIP~~t~~eH~~~vt 313 (839)
T KOG0269|consen 261 -NTIAPVGRVKWRPARSYHLATCSMVVDTSVHVWDVRRPYIPYATFLEHTDSVT 313 (839)
T ss_pred -eecceeeeeeeccCccchhhhhhccccceEEEEeeccccccceeeeccCcccc
Confidence 35578999999998765 666665 6789999998 4555568888877665
No 87
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.46 E-value=7.3e-12 Score=137.31 Aligned_cols=225 Identities=15% Similarity=0.248 Sum_probs=157.7
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEe---eeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDL---VSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGL 184 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~el---vS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~ 184 (921)
.++..+-+..+++|-.+......+. +..|.++|-++..++.. ..+|+++|
T Consensus 161 ~fvsas~Dqtl~Lw~~~~~~~~~~~~~~~~GHk~~V~sVsv~~sg----------------tr~~SgS~----------- 213 (423)
T KOG0313|consen 161 LFVSASMDQTLRLWKWNVGENKVKALKVCRGHKRSVDSVSVDSSG----------------TRFCSGSW----------- 213 (423)
T ss_pred eEEEecCCceEEEEEecCchhhhhHHhHhcccccceeEEEecCCC----------------CeEEeecc-----------
Confidence 4666666778899998885443333 34788889988887531 12344433
Q ss_pred ccccCCCCCCcCCCCCCCCCCcEEEEEEC-------------------------CCCcEEEEEe-CCCCEEEEEEcC--C
Q 002446 185 ATACNGTSANYHDLGNGSSVPTVVHFYSL-------------------------RSQSYVHMLK-FRSPIYSVRCSS--R 236 (921)
Q Consensus 185 ~~~~~g~~~~~h~~g~~~~~~~tVrIWDL-------------------------~Tg~~V~tL~-f~s~V~sV~~S~--r 236 (921)
+++|+||+. .++..+-+|. +..+|.+|.|+. -
T Consensus 214 --------------------D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d~~v 273 (423)
T KOG0313|consen 214 --------------------DTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSDATV 273 (423)
T ss_pred --------------------cceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcCCCc
Confidence 377888881 1223344454 467999999974 4
Q ss_pred EEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccc
Q 002446 237 VVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFS 316 (921)
Q Consensus 237 iLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~ 316 (921)
+..++.|-+|+.||+.+++++-++.+... ++.+ +|.+ .
T Consensus 274 ~yS~SwDHTIk~WDletg~~~~~~~~~ks-------------l~~i-------~~~~-------------~--------- 311 (423)
T KOG0313|consen 274 IYSVSWDHTIKVWDLETGGLKSTLTTNKS-------------LNCI-------SYSP-------------L--------- 311 (423)
T ss_pred eEeecccceEEEEEeecccceeeeecCcc-------------eeEe-------eccc-------------c---------
Confidence 55568899999999999999888765321 1111 2220 0
Q ss_pred cccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEE
Q 002446 317 GFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRD 396 (921)
Q Consensus 317 ~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwD 396 (921)
...++.+..+..+++||
T Consensus 312 ---------------------------------------------------------------~~Ll~~gssdr~irl~D 328 (423)
T KOG0313|consen 312 ---------------------------------------------------------------SKLLASGSSDRHIRLWD 328 (423)
T ss_pred ---------------------------------------------------------------cceeeecCCCCceeecC
Confidence 00122334566799999
Q ss_pred CCCC---ceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccE
Q 002446 397 IVSK---NVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVI 472 (921)
Q Consensus 397 l~s~---~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I 472 (921)
..++ -+..+|.+|+.-|+++.++|... +|+++|.|++ +++||+... ...+|.+.+. .-+|
T Consensus 329 PR~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~~S~S~D~t-~klWDvRS~-------------k~plydI~~h--~DKv 392 (423)
T KOG0313|consen 329 PRTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQLVSGSYDNT-VKLWDVRST-------------KAPLYDIAGH--NDKV 392 (423)
T ss_pred CCCCCCceeEEeeecchhhhhheecCCCCceEEEEEecCCe-EEEEEeccC-------------CCcceeeccC--CceE
Confidence 8875 35678899999999999999654 7899999998 899999874 1257888653 4569
Q ss_pred EEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 473 QDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 473 ~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.++.|. ++..|++|+.|.+++||.-.+.
T Consensus 393 l~vdW~-~~~~IvSGGaD~~l~i~~~~~~ 420 (423)
T KOG0313|consen 393 LSVDWN-EGGLIVSGGADNKLRIFKGSPI 420 (423)
T ss_pred EEEecc-CCceEEeccCcceEEEeccccc
Confidence 999997 6789999999999999986653
No 88
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.46 E-value=6.3e-11 Score=125.60 Aligned_cols=240 Identities=15% Similarity=0.221 Sum_probs=169.6
Q ss_pred CCCCCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCC--CeEEeee-eecCCEEEEEEecCCCCCccccC
Q 002446 82 RDDESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEAD--NVHDLVS-RYDGPVSFMQMLPRPITSKRSRD 157 (921)
Q Consensus 82 ~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~--~~~elvS-~~dG~Vr~v~~lP~P~~~~~~~d 157 (921)
+...+|+++|-.+.|.+.. | .+|+.|. ++.++||+....+ .++.+++ .|...||.++..|.
T Consensus 8 ~~~~gh~~r~W~~awhp~~--g----~ilAscg~Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~--------- 72 (312)
T KOG0645|consen 8 QKLSGHKDRVWSVAWHPGK--G----VILASCGTDKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPH--------- 72 (312)
T ss_pred EeecCCCCcEEEEEeccCC--c----eEEEeecCCceEEEEecCCCCcEEEEEeccccchheeeeeeecCC---------
Confidence 3456899999999999911 3 4555554 6679999998522 2444443 57788999999873
Q ss_pred ccccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCC--cEEEEEeC-CCCEEEEEEc
Q 002446 158 KFAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQ--SYVHMLKF-RSPIYSVRCS 234 (921)
Q Consensus 158 ~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg--~~V~tL~f-~s~V~sV~~S 234 (921)
..+||.++- | +++-||.-..+ +++.+|+. .+.|..|++|
T Consensus 73 -----g~~La~aSF----------D-----------------------~t~~Iw~k~~~efecv~~lEGHEnEVK~Vaws 114 (312)
T KOG0645|consen 73 -----GRYLASASF----------D-----------------------ATVVIWKKEDGEFECVATLEGHENEVKCVAWS 114 (312)
T ss_pred -----CcEEEEeec----------c-----------------------ceEEEeecCCCceeEEeeeeccccceeEEEEc
Confidence 136665542 2 67889976555 68888875 6799999996
Q ss_pred --CCEEEE-EeCCEEEEEECCCC---cEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcc
Q 002446 235 --SRVVAI-CQAAQVHCFDAATL---EIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQH 308 (921)
Q Consensus 235 --~riLAV-a~d~~I~IwDl~T~---~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~ 308 (921)
+++||. +-++.|-||.+... ++...|..|.. +
T Consensus 115 ~sG~~LATCSRDKSVWiWe~deddEfec~aVL~~Htq-----D------------------------------------- 152 (312)
T KOG0645|consen 115 ASGNYLATCSRDKSVWIWEIDEDDEFECIAVLQEHTQ-----D------------------------------------- 152 (312)
T ss_pred CCCCEEEEeeCCCeEEEEEecCCCcEEEEeeeccccc-----c-------------------------------------
Confidence 799999 56889999998743 33333333311 0
Q ss_pred cccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCC
Q 002446 309 LMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADN 388 (921)
Q Consensus 309 l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~ 388 (921)
| |.++ |++ . -..++++.+
T Consensus 153 ----------------V--------K~V~----------WHP----------t------------------~dlL~S~SY 170 (312)
T KOG0645|consen 153 ----------------V--------KHVI----------WHP----------T------------------EDLLFSCSY 170 (312)
T ss_pred ----------------c--------cEEE----------EcC----------C------------------cceeEEecc
Confidence 0 0000 000 0 012345677
Q ss_pred CCEEEEEECC---CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 389 VGMVIVRDIV---SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 389 ~G~V~IwDl~---s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
|.+|++|+-. .-.++++|.+|...|-+++|+|.|..|++|++|++ ++||..... + .
T Consensus 171 DnTIk~~~~~~dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD~t-v~Iw~~~~~-------------------~-~ 229 (312)
T KOG0645|consen 171 DNTIKVYRDEDDDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDDGT-VSIWRLYTD-------------------L-S 229 (312)
T ss_pred CCeEEEEeecCCCCeeEEEEecCccceEEEEEecCCCceEEEecCCcc-eEeeeeccC-------------------c-c
Confidence 8899999766 23689999999999999999999999999999998 899986643 1 1
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
+.+...+++++|. .-.||+++.|+.|+||.....
T Consensus 230 ~~~sr~~Y~v~W~--~~~IaS~ggD~~i~lf~~s~~ 263 (312)
T KOG0645|consen 230 GMHSRALYDVPWD--NGVIASGGGDDAIRLFKESDS 263 (312)
T ss_pred hhcccceEeeeec--ccceEeccCCCEEEEEEecCC
Confidence 2223358999998 557999999999999998753
No 89
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.46 E-value=7.9e-13 Score=141.56 Aligned_cols=86 Identities=19% Similarity=0.313 Sum_probs=75.6
Q ss_pred CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe
Q 002446 409 HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS 488 (921)
Q Consensus 409 H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS 488 (921)
|+..|+++.+|+.|++.+|||.||. |+|||--.+ +++.++.+.|..+.|.+..|+.||+||.+++
T Consensus 260 ht~ai~~V~Ys~t~~lYvTaSkDG~-IklwDGVS~--------------rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG 324 (430)
T KOG0640|consen 260 HTGAITQVRYSSTGSLYVTASKDGA-IKLWDGVSN--------------RCVRTIGNAHGGSEVCSAVFTKNGKYILSSG 324 (430)
T ss_pred cccceeEEEecCCccEEEEeccCCc-EEeeccccH--------------HHHHHHHhhcCCceeeeEEEccCCeEEeecC
Confidence 6778999999999999999999998 999996654 5666777778788899999999999999999
Q ss_pred CCCcEEEEecCCCCCceeecC
Q 002446 489 SRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 489 ~DgTVhVWdi~~~g~~~~l~~ 509 (921)
+|.++++|.|.++.....+.+
T Consensus 325 ~DS~vkLWEi~t~R~l~~YtG 345 (430)
T KOG0640|consen 325 KDSTVKLWEISTGRMLKEYTG 345 (430)
T ss_pred CcceeeeeeecCCceEEEEec
Confidence 999999999999766666544
No 90
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.44 E-value=1.7e-13 Score=147.00 Aligned_cols=110 Identities=23% Similarity=0.395 Sum_probs=97.7
Q ss_pred cccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+++..||.|+||-+.+|.++..|. +|+..|+||.||.|+..+.++|.|.+ +||--+..+ .++.+
T Consensus 279 AsGsqDGkIKvWri~tG~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~t-vRiHGlKSG--------------K~LKE 343 (508)
T KOG0275|consen 279 ASGSQDGKIKVWRIETGQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQT-VRIHGLKSG--------------KCLKE 343 (508)
T ss_pred hccCcCCcEEEEEEecchHHHHhhhhhccCeeEEEEccCcchhhcccccce-EEEeccccc--------------hhHHH
Confidence 456778999999999999999998 99999999999999999999999976 899988875 56666
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
+ |||+.. |+...|++||.++.++|.||||+||+..+..+..+++.-
T Consensus 344 f-rGHsSy-vn~a~ft~dG~~iisaSsDgtvkvW~~KtteC~~Tfk~~ 389 (508)
T KOG0275|consen 344 F-RGHSSY-VNEATFTDDGHHIISASSDGTVKVWHGKTTECLSTFKPL 389 (508)
T ss_pred h-cCcccc-ccceEEcCCCCeEEEecCCccEEEecCcchhhhhhccCC
Confidence 6 787654 999999999999999999999999999998887777643
No 91
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.44 E-value=1.7e-11 Score=145.71 Aligned_cols=241 Identities=15% Similarity=0.261 Sum_probs=165.2
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
.|++..+-++||. +|. -++.+|.++-+++|++....+--+.+..+...|.+++.-- ..
T Consensus 11 aht~G~t~i~~d~---~ge---fi~tcgsdg~ir~~~~~sd~e~P~ti~~~g~~v~~ia~~s----------------~~ 68 (933)
T KOG1274|consen 11 AHTGGLTLICYDP---DGE---FICTCGSDGDIRKWKTNSDEEEPETIDISGELVSSIACYS----------------NH 68 (933)
T ss_pred hccCceEEEEEcC---CCC---EEEEecCCCceEEeecCCcccCCchhhccCceeEEEeecc----------------cc
Confidence 5788899999998 774 5555666666999999875233344444445566554321 13
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEE-eCCCCEEEEEE--cCCEEEE-E
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHML-KFRSPIYSVRC--SSRVVAI-C 241 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL-~f~s~V~sV~~--S~riLAV-a 241 (921)
++++.. +++|.+|....++.=..| +|.-++..+++ +++++|. +
T Consensus 69 f~~~s~---------------------------------~~tv~~y~fps~~~~~iL~Rftlp~r~~~v~g~g~~iaags 115 (933)
T KOG1274|consen 69 FLTGSE---------------------------------QNTVLRYKFPSGEEDTILARFTLPIRDLAVSGSGKMIAAGS 115 (933)
T ss_pred eEEeec---------------------------------cceEEEeeCCCCCccceeeeeeccceEEEEecCCcEEEeec
Confidence 333332 278999988887643222 34455666666 4678877 5
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
.|..|+|-++.+....+.+..|.- |+- -|-|. |+
T Consensus 116 dD~~vK~~~~~D~s~~~~lrgh~a---------------pVl----~l~~~-------------p~-------------- 149 (933)
T KOG1274|consen 116 DDTAVKLLNLDDSSQEKVLRGHDA---------------PVL----QLSYD-------------PK-------------- 149 (933)
T ss_pred CceeEEEEeccccchheeecccCC---------------cee----eeeEc-------------CC--------------
Confidence 667999999999888888776632 110 12222 11
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
+.. ++....+|+|+|||++++.
T Consensus 150 ~~f----------------------------------------------------------LAvss~dG~v~iw~~~~~~ 171 (933)
T KOG1274|consen 150 GNF----------------------------------------------------------LAVSSCDGKVQIWDLQDGI 171 (933)
T ss_pred CCE----------------------------------------------------------EEEEecCceEEEEEcccch
Confidence 111 1122457999999999987
Q ss_pred eEEEeccC--------CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 402 VIAQFRAH--------KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 402 ~l~~~~aH--------~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
+..++.+- ...+..++|+|+|-.||....|++ |++|+.... .+.++|+--+..+.+.
T Consensus 172 ~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~~~d~~-Vkvy~r~~w--------------e~~f~Lr~~~~ss~~~ 236 (933)
T KOG1274|consen 172 LSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVPPVDNT-VKVYSRKGW--------------ELQFKLRDKLSSSKFS 236 (933)
T ss_pred hhhhcccCCccccccccceeeeeeecCCCCeEEeeccCCe-EEEEccCCc--------------eeheeecccccccceE
Confidence 76666521 356777999999666777777766 899998865 5667886555556699
Q ss_pred EEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 474 DISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
+++|||+|+|||+++.||-|-|||..+
T Consensus 237 ~~~wsPnG~YiAAs~~~g~I~vWnv~t 263 (933)
T KOG1274|consen 237 DLQWSPNGKYIAASTLDGQILVWNVDT 263 (933)
T ss_pred EEEEcCCCcEEeeeccCCcEEEEeccc
Confidence 999999999999999999999999985
No 92
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.43 E-value=1.2e-11 Score=130.76 Aligned_cols=188 Identities=16% Similarity=0.191 Sum_probs=135.9
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEc--CCEEE-EEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCS--SRVVA-ICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S--~riLA-Va~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
.+..+|=...|+.+-++.- ...|+.+.++ .+.|+ -+.|.++++||..+++++.++++...+..+ .
T Consensus 32 ~~~~vw~s~nGerlGty~GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~~~~Vk~~-----------~ 100 (327)
T KOG0643|consen 32 STPTVWYSLNGERLGTYDGHTGAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKTNSPVKRV-----------D 100 (327)
T ss_pred CCceEEEecCCceeeeecCCCceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeecCCeeEEE-----------e
Confidence 4466888889999999975 6789988885 34444 488999999999999999998763111000 0
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
+..+...+.+...+
T Consensus 101 F~~~gn~~l~~tD~------------------------------------------------------------------ 114 (327)
T KOG0643|consen 101 FSFGGNLILASTDK------------------------------------------------------------------ 114 (327)
T ss_pred eccCCcEEEEEehh------------------------------------------------------------------
Confidence 11111111111000
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC-------CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCE
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV-------SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHN 434 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~-------s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~ 434 (921)
.-+..+.|.++|+. +..++..+..+.+.|+.+-|+|-|+.|++|..||.
T Consensus 115 -----------------------~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~- 170 (327)
T KOG0643|consen 115 -----------------------QMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGS- 170 (327)
T ss_pred -----------------------hcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecccCCEEEEecCCCc-
Confidence 00223567777766 55678888889999999999999999999999997
Q ss_pred EEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 435 INIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 435 IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
|++||+.++ ..+..-.+-| .+.|++|.||||..++.++|.|.|.++||+.+...+.++.+
T Consensus 171 is~~da~~g--------------~~~v~s~~~h-~~~Ind~q~s~d~T~FiT~s~Dttakl~D~~tl~v~Kty~t 230 (327)
T KOG0643|consen 171 ISIYDARTG--------------KELVDSDEEH-SSKINDLQFSRDRTYFITGSKDTTAKLVDVRTLEVLKTYTT 230 (327)
T ss_pred EEEEEcccC--------------ceeeechhhh-ccccccccccCCcceEEecccCccceeeeccceeeEEEeee
Confidence 999999986 2333332333 34699999999999999999999999999998766666654
No 93
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.43 E-value=5e-13 Score=153.76 Aligned_cols=188 Identities=15% Similarity=0.272 Sum_probs=141.9
Q ss_pred cEEEEEECCCCc------EEEEEeC-CCCEEEEEE--cC-CEEEEEeCCEEEEEECCCC--cEEEEEecCCCccCCCCCC
Q 002446 206 TVVHFYSLRSQS------YVHMLKF-RSPIYSVRC--SS-RVVAICQAAQVHCFDAATL--EIEYAILTNPIVMGHPSAG 273 (921)
Q Consensus 206 ~tVrIWDL~Tg~------~V~tL~f-~s~V~sV~~--S~-riLAVa~d~~I~IwDl~T~--~~l~tL~t~p~~~g~p~~~ 273 (921)
+.|++|+..... ++.+++. ...|.++.. ++ .+|.++.|.+|++|++... -|+.+|.+|.+..
T Consensus 47 g~i~~W~~~~d~~~~s~~~~asme~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~~c~stir~H~DYV------ 120 (735)
T KOG0308|consen 47 GIIRLWSVTQDSNEPSTPYIASMEHHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNTFCMSTIRTHKDYV------ 120 (735)
T ss_pred ceEEEeccccccCCcccchhhhhhhhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcchhHhhhhcccchh------
Confidence 789999986553 3555554 457777666 34 4555688999999999876 5677777775421
Q ss_pred CCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCcccccccc
Q 002446 274 GIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQ 353 (921)
Q Consensus 274 g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~ 353 (921)
..|||.... .
T Consensus 121 -------------kcla~~ak~--------------------------~------------------------------- 130 (735)
T KOG0308|consen 121 -------------KCLAYIAKN--------------------------N------------------------------- 130 (735)
T ss_pred -------------eeeeecccC--------------------------c-------------------------------
Confidence 124553110 0
Q ss_pred ccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC--ceEE--------Eec-cCCCCeEEEEECCCC
Q 002446 354 YCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK--NVIA--------QFR-AHKSPISALCFDPSG 422 (921)
Q Consensus 354 y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~--~~l~--------~~~-aH~~pIsaLaFSPdG 422 (921)
-.+++++-++.|.|||+.++ +.++ .+. +|..+|.+|+.++.|
T Consensus 131 ---------------------------~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~ 183 (735)
T KOG0308|consen 131 ---------------------------ELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTG 183 (735)
T ss_pred ---------------------------eeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCCcc
Confidence 01234456789999999876 2222 233 888999999999999
Q ss_pred CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 423 ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 423 tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
+++++|+..+- +++||-.+. ..+.+|+ ||+.. |.+|-.++||+.+.++|+||||+|||+....
T Consensus 184 t~ivsGgtek~-lr~wDprt~--------------~kimkLr-GHTdN-Vr~ll~~dDGt~~ls~sSDgtIrlWdLgqQr 246 (735)
T KOG0308|consen 184 TIIVSGGTEKD-LRLWDPRTC--------------KKIMKLR-GHTDN-VRVLLVNDDGTRLLSASSDGTIRLWDLGQQR 246 (735)
T ss_pred eEEEecCcccc-eEEeccccc--------------cceeeee-ccccc-eEEEEEcCCCCeEeecCCCceEEeeeccccc
Confidence 99999999975 999998875 5667774 88764 9999999999999999999999999999998
Q ss_pred CceeecCCCCC
Q 002446 503 GSVNFQPTDAN 513 (921)
Q Consensus 503 ~~~~l~~H~~~ 513 (921)
+..++..|...
T Consensus 247 Cl~T~~vH~e~ 257 (735)
T KOG0308|consen 247 CLATYIVHKEG 257 (735)
T ss_pred eeeeEEeccCc
Confidence 99999999665
No 94
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.42 E-value=9.6e-12 Score=138.89 Aligned_cols=114 Identities=14% Similarity=0.240 Sum_probs=86.5
Q ss_pred cccCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 384 PDADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
++++.|++|.+||+++. +++.+|.+|...|..|.|||. -+.||+++.|++ ++|||+..-....+......+....+
T Consensus 289 AT~S~D~tV~LwDlRnL~~~lh~~e~H~dev~~V~WSPh~etvLASSg~D~r-l~vWDls~ig~eq~~eda~dgppEll- 366 (422)
T KOG0264|consen 289 ATGSADKTVALWDLRNLNKPLHTFEGHEDEVFQVEWSPHNETVLASSGTDRR-LNVWDLSRIGEEQSPEDAEDGPPELL- 366 (422)
T ss_pred EeccCCCcEEEeechhcccCceeccCCCcceEEEEeCCCCCceeEecccCCc-EEEEeccccccccChhhhccCCccee-
Confidence 45567899999999985 578999999999999999995 679999999998 89999976311111111111122333
Q ss_pred EEecccccccEEEEEEccCCCE-EEEEeCCCcEEEEecCC
Q 002446 462 RLQRGLTNAVIQDISFSDDSNW-IMISSSRGTSHLFAINP 500 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~-LAsgS~DgTVhVWdi~~ 500 (921)
=.++||+ ++|.+++|.|+-.| ||+++.|+.++||+...
T Consensus 367 F~HgGH~-~kV~DfsWnp~ePW~I~SvaeDN~LqIW~~s~ 405 (422)
T KOG0264|consen 367 FIHGGHT-AKVSDFSWNPNEPWTIASVAEDNILQIWQMAE 405 (422)
T ss_pred EEecCcc-cccccccCCCCCCeEEEEecCCceEEEeeccc
Confidence 3467765 57999999999888 56789999999999874
No 95
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.41 E-value=1e-11 Score=139.96 Aligned_cols=111 Identities=21% Similarity=0.252 Sum_probs=82.0
Q ss_pred ccccCCCCEEEEEECCCC--ceEEEe-ccCCC--CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 383 FPDADNVGMVIVRDIVSK--NVIAQF-RAHKS--PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~--~~l~~~-~aH~~--pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
++.+..+|.|.+||..+. ++...+ ++|.. .|+||+||+||++|++-+.|++ ++|||+... .
T Consensus 332 iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~t-LKvWDLrq~-------------k 397 (641)
T KOG0772|consen 332 IAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDT-LKVWDLRQF-------------K 397 (641)
T ss_pred hhhcccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhccCCCc-eeeeecccc-------------c
Confidence 345567899999998653 233333 49987 9999999999999999999997 899999874 1
Q ss_pred eEEEEEeccc-ccccEEEEEEccCCCEEEEEeC------CCcEEEEecCCCCCceeec
Q 002446 458 VHLYRLQRGL-TNAVIQDISFSDDSNWIMISSS------RGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 458 ~~l~~l~RG~-t~a~I~sIaFSPDg~~LAsgS~------DgTVhVWdi~~~g~~~~l~ 508 (921)
..|... .|. +...-++++||||.+.|++|++ -|++.+||-.++.....+.
T Consensus 398 kpL~~~-tgL~t~~~~tdc~FSPd~kli~TGtS~~~~~~~g~L~f~d~~t~d~v~ki~ 454 (641)
T KOG0772|consen 398 KPLNVR-TGLPTPFPGTDCCFSPDDKLILTGTSAPNGMTAGTLFFFDRMTLDTVYKID 454 (641)
T ss_pred cchhhh-cCCCccCCCCccccCCCceEEEecccccCCCCCceEEEEeccceeeEEEec
Confidence 223222 232 2233678999999999999875 4678888887776555553
No 96
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.41 E-value=8.4e-13 Score=141.67 Aligned_cols=206 Identities=14% Similarity=0.190 Sum_probs=149.0
Q ss_pred CcEEEEEECCCCcEEEEEeC---------CCCEEEEEEcC--CEEEE-EeCCEEEEEECCCCcEEEEEec-CCCccCCCC
Q 002446 205 PTVVHFYSLRSQSYVHMLKF---------RSPIYSVRCSS--RVVAI-CQAAQVHCFDAATLEIEYAILT-NPIVMGHPS 271 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f---------~s~V~sV~~S~--riLAV-a~d~~I~IwDl~T~~~l~tL~t-~p~~~g~p~ 271 (921)
++.|.+||..+|+..+.|++ ..+|..|.|++ .+||. +.|++|++|.+.|++|++.++. |..
T Consensus 234 DGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~tG~ClRrFdrAHtk------ 307 (508)
T KOG0275|consen 234 DGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRIETGQCLRRFDRAHTK------ 307 (508)
T ss_pred cceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEEecchHHHHhhhhhcc------
Confidence 37799999999999998875 46899999985 68888 8899999999999999887752 211
Q ss_pred CCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCcccccc
Q 002446 272 AGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKL 351 (921)
Q Consensus 272 ~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~l 351 (921)
+..+ |.|+- +
T Consensus 308 --------Gvt~-----l~FSr-------------------------------------D-------------------- 317 (508)
T KOG0275|consen 308 --------GVTC-----LSFSR-------------------------------------D-------------------- 317 (508)
T ss_pred --------CeeE-----EEEcc-------------------------------------C--------------------
Confidence 1111 22220 0
Q ss_pred ccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC
Q 002446 352 SQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ 431 (921)
Q Consensus 352 s~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D 431 (921)
+.++.++..|.+|+|.-+.+|+++..|++|++-|+...|++||..+++||.|
T Consensus 318 ----------------------------~SqiLS~sfD~tvRiHGlKSGK~LKEfrGHsSyvn~a~ft~dG~~iisaSsD 369 (508)
T KOG0275|consen 318 ----------------------------NSQILSASFDQTVRIHGLKSGKCLKEFRGHSSYVNEATFTDDGHHIISASSD 369 (508)
T ss_pred ----------------------------cchhhcccccceEEEeccccchhHHHhcCccccccceEEcCCCCeEEEecCC
Confidence 0012345667899999999999999999999999999999999999999999
Q ss_pred CCEEEEEeCCCCCCCC----CCcc-----------CCCC---------------ceeEEEEEecccc-cccEEEEEEccC
Q 002446 432 GHNINIFKIIPGILGT----SSAC-----------DAGT---------------SYVHLYRLQRGLT-NAVIQDISFSDD 480 (921)
Q Consensus 432 Gt~IrIWdi~~g~~~~----~s~~-----------~~~~---------------~~~~l~~l~RG~t-~a~I~sIaFSPD 480 (921)
|+ |+||+..+..+-. .+.. .+.. .+.-+..+..|.. .....+.+.||-
T Consensus 370 gt-vkvW~~KtteC~~Tfk~~~~d~~vnsv~~~PKnpeh~iVCNrsntv~imn~qGQvVrsfsSGkREgGdFi~~~lSpk 448 (508)
T KOG0275|consen 370 GT-VKVWHGKTTECLSTFKPLGTDYPVNSVILLPKNPEHFIVCNRSNTVYIMNMQGQVVRSFSSGKREGGDFINAILSPK 448 (508)
T ss_pred cc-EEEecCcchhhhhhccCCCCcccceeEEEcCCCCceEEEEcCCCeEEEEeccceEEeeeccCCccCCceEEEEecCC
Confidence 98 8999998752200 0000 0000 0011111211111 112456789999
Q ss_pred CCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 481 SNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
|.|+.+.+.|+.+..|.+.+++-..++..|...+.
T Consensus 449 GewiYcigED~vlYCF~~~sG~LE~tl~VhEkdvI 483 (508)
T KOG0275|consen 449 GEWIYCIGEDGVLYCFSVLSGKLERTLPVHEKDVI 483 (508)
T ss_pred CcEEEEEccCcEEEEEEeecCceeeeeeccccccc
Confidence 99999999999999999999888888888765544
No 97
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.41 E-value=8.8e-11 Score=126.24 Aligned_cols=275 Identities=18% Similarity=0.239 Sum_probs=163.4
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCC-CCeEEeee--eecCCEEEEEEecCCCCCccccCccc
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEA-DNVHDLVS--RYDGPVSFMQMLPRPITSKRSRDKFA 160 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~-~~~~elvS--~~dG~Vr~v~~lP~P~~~~~~~d~F~ 160 (921)
+.+|+|-|..+.||. -| |++.....+..++|||.+.. ++..-.-+ .|+|.|--+...+ |-
T Consensus 9 ~s~h~DlihdVs~D~---~G---RRmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAh-PE---------- 71 (361)
T KOG2445|consen 9 DSGHKDLIHDVSFDF---YG---RRMATCSSDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAH-PE---------- 71 (361)
T ss_pred ccCCcceeeeeeecc---cC---ceeeeccCCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecC-cc----------
Confidence 356899999999999 55 56666666778999996443 44433333 4678877777764 21
Q ss_pred cCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEEC-----CCC--c--EEEEEe-CCCCEEE
Q 002446 161 EVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSL-----RSQ--S--YVHMLK-FRSPIYS 230 (921)
Q Consensus 161 ~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL-----~Tg--~--~V~tL~-f~s~V~s 230 (921)
-...||.|+- | ++|+||.- +.+ + ...+|. -++.|++
T Consensus 72 -fGqvvA~cS~----------D-----------------------rtv~iWEE~~~~~~~~~~~Wv~~ttl~DsrssV~D 117 (361)
T KOG2445|consen 72 -FGQVVATCSY----------D-----------------------RTVSIWEEQEKSEEAHGRRWVRRTTLVDSRSSVTD 117 (361)
T ss_pred -ccceEEEEec----------C-----------------------CceeeeeecccccccccceeEEEEEeecCCcceeE
Confidence 1357888873 2 67888854 221 1 223333 3789999
Q ss_pred EEEcCC-----EEEEEeCCEEEEEECCCCcEEEEEe-cCCC--ccCCCCCCCCCccccceeecCceEEecCCCceecCCC
Q 002446 231 VRCSSR-----VVAICQAAQVHCFDAATLEIEYAIL-TNPI--VMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDG 302 (921)
Q Consensus 231 V~~S~r-----iLAVa~d~~I~IwDl~T~~~l~tL~-t~p~--~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~G 302 (921)
|.|.++ +.++..++.++||++-..-.+.... .|.. ....|+. ......+ ..|+.+
T Consensus 118 V~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~----~~~~~~C-------------vsWn~s 180 (361)
T KOG2445|consen 118 VKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGK----NKQPCFC-------------VSWNPS 180 (361)
T ss_pred EEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCccc----ccCcceE-------------Eeeccc
Confidence 999753 3344788999999987643222110 1100 0000000 0000011 112222
Q ss_pred ccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCc
Q 002446 303 RVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGH 382 (921)
Q Consensus 303 rvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~ 382 (921)
|.+++.+ | +| +.
T Consensus 181 r~~~p~i---------------------------A-----vg-------------------------s~----------- 192 (361)
T KOG2445|consen 181 RMHEPLI---------------------------A-----VG-------------------------SD----------- 192 (361)
T ss_pred cccCceE---------------------------E-----EE-------------------------cc-----------
Confidence 2111100 0 00 00
Q ss_pred ccccCCCCEEEEEECCCC----ceEEEeccCCCCeEEEEECCC-C---CEEEEEecCCCEEEEEeCCCCCC-----CCCC
Q 002446 383 FPDADNVGMVIVRDIVSK----NVIAQFRAHKSPISALCFDPS-G---ILLVTASVQGHNINIFKIIPGIL-----GTSS 449 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~----~~l~~~~aH~~pIsaLaFSPd-G---tlLATaS~DGt~IrIWdi~~g~~-----~~~s 449 (921)
-+...-+.++||..... ..++++..|+.||++|+|.|+ | .+||+|+.|| |+||.+..-.. +...
T Consensus 193 -e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~y~~lAvA~kDg--v~I~~v~~~~s~i~~ee~~~ 269 (361)
T KOG2445|consen 193 -EDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRSYHLLAVATKDG--VRIFKVKVARSAIEEEEVLA 269 (361)
T ss_pred -cCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCceeeEEEeecCc--EEEEEEeeccchhhhhcccC
Confidence 01223467888876543 356788899999999999996 4 4899999998 89999985311 0000
Q ss_pred ccCC-CCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 450 ACDA-GTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 450 ~~~~-~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
.... ...+..+..+ +.+...|+.+.|.-.|..|+++++||+||+|..+
T Consensus 270 ~~~~~~l~v~~vs~~--~~H~~~VWrv~wNmtGtiLsStGdDG~VRLWkan 318 (361)
T KOG2445|consen 270 PDLMTDLPVEKVSEL--DDHNGEVWRVRWNMTGTILSSTGDDGCVRLWKAN 318 (361)
T ss_pred CCCccccceEEeeec--cCCCCceEEEEEeeeeeEEeecCCCceeeehhhh
Confidence 0000 1122222223 3345579999999999999999999999999865
No 98
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.40 E-value=6.7e-12 Score=145.12 Aligned_cols=214 Identities=18% Similarity=0.342 Sum_probs=143.1
Q ss_pred cEEEEEECCCCcEEEEEe-CCCCEEEEEEc-----CCEEEE-EeCCEEEEEECC-CCcEEEEEecCCCccCCCCCCCCCc
Q 002446 206 TVVHFYSLRSQSYVHMLK-FRSPIYSVRCS-----SRVVAI-CQAAQVHCFDAA-TLEIEYAILTNPIVMGHPSAGGIGI 277 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S-----~riLAV-a~d~~I~IwDl~-T~~~l~tL~t~p~~~g~p~~~g~~i 277 (921)
+++|+|||..-++...++ +.+.|..+.++ .++||. +-++-|+|||+. ...+++++..|... +
T Consensus 481 GnlrVy~Lq~l~~~~~~eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rny~l~qtld~HSss----------I 550 (1080)
T KOG1408|consen 481 GNLRVYDLQELEYTCFMEAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRNYDLVQTLDGHSSS----------I 550 (1080)
T ss_pred CceEEEEehhhhhhhheecccceeEEEeecCchhhhHhhhhccCCceEEEEecccccchhhhhcccccc----------e
Confidence 789999999888887776 47899999997 367887 567899999986 45667788776431 1
Q ss_pred cccceeec---CceEEecCCCcee------cCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccc
Q 002446 278 GYGPLAVG---PRWLAYSGSPVVV------SNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGY 348 (921)
Q Consensus 278 ~~~piAlg---pRwLAyas~~~~~------s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~ 348 (921)
..-.+|-+ -+.|....++.+. ...|++.|.+- .++ +| .++-|+.
T Consensus 551 TsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t-------------~t~-------~k------tTlYDm~- 603 (1080)
T KOG1408|consen 551 TSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHT-------------QTL-------SK------TTLYDMA- 603 (1080)
T ss_pred eEEEEeecCCceEEEeccCchhhheehhccccCceeccccc-------------ccc-------cc------ceEEEee-
Confidence 00011110 0222222221110 01111111100 000 00 0011111
Q ss_pred cccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEec---cCCCCeEEEEECCCCCEE
Q 002446 349 KKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFR---AHKSPISALCFDPSGILL 425 (921)
Q Consensus 349 k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~---aH~~pIsaLaFSPdGtlL 425 (921)
+-|.+ ++.+.+..|..|+|||+.+++.++.|+ .|.+..-.|..+|+|-||
T Consensus 604 --------------------Vdp~~-------k~v~t~cQDrnirif~i~sgKq~k~FKgs~~~eG~lIKv~lDPSgiY~ 656 (1080)
T KOG1408|consen 604 --------------------VDPTS-------KLVVTVCQDRNIRIFDIESGKQVKSFKGSRDHEGDLIKVILDPSGIYL 656 (1080)
T ss_pred --------------------eCCCc-------ceEEEEecccceEEEeccccceeeeecccccCCCceEEEEECCCccEE
Confidence 11111 245667889999999999999999998 566778889999999999
Q ss_pred EEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 426 VTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 426 ATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
||...|.+ +-+||.-.+ +++.+. .||..+ |+.+.|++|.++|.+.+.||.|.||.+..
T Consensus 657 atScsdkt-l~~~Df~sg--------------EcvA~m-~GHsE~-VTG~kF~nDCkHlISvsgDgCIFvW~lp~ 714 (1080)
T KOG1408|consen 657 ATSCSDKT-LCFVDFVSG--------------ECVAQM-TGHSEA-VTGVKFLNDCKHLISVSGDGCIFVWKLPL 714 (1080)
T ss_pred EEeecCCc-eEEEEeccc--------------hhhhhh-cCcchh-eeeeeecccchhheeecCCceEEEEECch
Confidence 99999987 899999876 344444 365544 99999999999999999999999999965
No 99
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.40 E-value=2.4e-12 Score=145.07 Aligned_cols=113 Identities=16% Similarity=0.329 Sum_probs=85.9
Q ss_pred cccccCCCCEEEEEECCCC-ceEEEec-----cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 382 HFPDADNVGMVIVRDIVSK-NVIAQFR-----AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~-~~l~~~~-----aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
.|.++..||+++|||+..- +.+..|+ +-.-+++.++|+|||+++|+|..||. |.+|+...-
T Consensus 283 ~FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGS-IQ~W~~~~~------------ 349 (641)
T KOG0772|consen 283 EFLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGS-IQIWDKGSR------------ 349 (641)
T ss_pred ceEEecCCCcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCc-eeeeecCCc------------
Confidence 5677889999999999764 3333343 23358899999999999999999996 999997432
Q ss_pred ceeEEEEEeccccc-ccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 456 SYVHLYRLQRGLTN-AVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 456 ~~~~l~~l~RG~t~-a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
.++..+.++..|.. ..|+||+||+||++|++-+.|+|++||||..+.+....
T Consensus 350 ~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~tLKvWDLrq~kkpL~~ 402 (641)
T KOG0772|consen 350 TVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDTLKVWDLRQFKKPLNV 402 (641)
T ss_pred ccccceEeeeccCCCCceeEEEeccccchhhhccCCCceeeeeccccccchhh
Confidence 11223333333433 24999999999999999999999999999988766543
No 100
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.40 E-value=2.9e-11 Score=134.37 Aligned_cols=226 Identities=14% Similarity=0.216 Sum_probs=157.0
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
.++..|-+...-++|... +....++.+|.-.|..+.+.|. +..+..+.
T Consensus 233 ~ilTGG~d~~av~~d~~s-~q~l~~~~Gh~kki~~v~~~~~----------------~~~v~~aS--------------- 280 (506)
T KOG0289|consen 233 KILTGGEDKTAVLFDKPS-NQILATLKGHTKKITSVKFHKD----------------LDTVITAS--------------- 280 (506)
T ss_pred cceecCCCCceEEEecch-hhhhhhccCcceEEEEEEeccc----------------hhheeecC---------------
Confidence 455555566899999887 4556677778777777766542 11111111
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEE--cCCEEEE-EeCCEEEEEECCCCcEEEEEecC
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRC--SSRVVAI-CQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~--S~riLAV-a~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
....|++|+.....+...+. +..+|..+.. ++.++.. +.++++.+.|++++.++-.....
T Consensus 281 ----------------ad~~i~vws~~~~s~~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~ 344 (506)
T KOG0289|consen 281 ----------------ADEIIRVWSVPLSSEPTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVSDE 344 (506)
T ss_pred ----------------CcceEEeeccccccCccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEeec
Confidence 12679999998777666655 4678988888 4677665 67789999999999876544321
Q ss_pred CCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEec
Q 002446 264 PIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNL 343 (921)
Q Consensus 264 p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~l 343 (921)
.. .+++ ..++| +|+
T Consensus 345 ~s---------------~v~~--ts~~f-------------HpD------------------------------------ 358 (506)
T KOG0289|consen 345 TS---------------DVEY--TSAAF-------------HPD------------------------------------ 358 (506)
T ss_pred cc---------------ccee--EEeeE-------------cCC------------------------------------
Confidence 00 0110 00111 122
Q ss_pred CCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCC
Q 002446 344 GDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI 423 (921)
Q Consensus 344 Gd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt 423 (921)
+ . .|..+..+|.|+|||+.++..++.|.+|+++|.+++|+-+|-
T Consensus 359 ------------------g---------------L---ifgtgt~d~~vkiwdlks~~~~a~Fpght~~vk~i~FsENGY 402 (506)
T KOG0289|consen 359 ------------------G---------------L---IFGTGTPDGVVKIWDLKSQTNVAKFPGHTGPVKAISFSENGY 402 (506)
T ss_pred ------------------c---------------e---EEeccCCCceEEEEEcCCccccccCCCCCCceeEEEeccCce
Confidence 1 0 122345679999999999999999999999999999999999
Q ss_pred EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 424 LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 424 lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+|||+.+|+. |++||+... .....+.+... ..|.+++|.+.|+||++++.|=+|++++-.
T Consensus 403 ~Lat~add~~-V~lwDLRKl------------~n~kt~~l~~~---~~v~s~~fD~SGt~L~~~g~~l~Vy~~~k~ 462 (506)
T KOG0289|consen 403 WLATAADDGS-VKLWDLRKL------------KNFKTIQLDEK---KEVNSLSFDQSGTYLGIAGSDLQVYICKKK 462 (506)
T ss_pred EEEEEecCCe-EEEEEehhh------------cccceeecccc---ccceeEEEcCCCCeEEeecceeEEEEEecc
Confidence 9999999986 999999874 11222333222 248999999999999999888888887743
No 101
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.39 E-value=6.8e-11 Score=124.81 Aligned_cols=222 Identities=13% Similarity=0.227 Sum_probs=154.4
Q ss_pred cccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCC
Q 002446 98 KLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCG 177 (921)
Q Consensus 98 ~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~ 177 (921)
|+.++......+.....+..+++||+-.. ++...+...-+.+. +...|. ...+++...
T Consensus 69 ql~w~~~~~d~~atas~dk~ir~wd~r~~-k~~~~i~~~~eni~-i~wsp~--------------g~~~~~~~k------ 126 (313)
T KOG1407|consen 69 QLCWDPKHPDLFATASGDKTIRIWDIRSG-KCTARIETKGENIN-ITWSPD--------------GEYIAVGNK------ 126 (313)
T ss_pred hheeCCCCCcceEEecCCceEEEEEeccC-cEEEEeeccCcceE-EEEcCC--------------CCEEEEecC------
Confidence 33333333346666666788999999874 44333333334433 335542 123333321
Q ss_pred ccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEE-EeCCEEEEEECCCC
Q 002446 178 TKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAI-CQAAQVHCFDAATL 254 (921)
Q Consensus 178 ~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~ 254 (921)
+..|.+.|.++.+.+++.+|+-.+..+.++ ..++.. ..-+.|.|...-.+
T Consensus 127 ---------------------------dD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsypsL 179 (313)
T KOG1407|consen 127 ---------------------------DDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYPSL 179 (313)
T ss_pred ---------------------------cccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEEEecccc
Confidence 145889999999999999999888888885 344433 45589999998899
Q ss_pred cEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcch
Q 002446 255 EIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSK 334 (921)
Q Consensus 255 ~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK 334 (921)
+.+++|..||. +.+++ .|. |. |+
T Consensus 180 kpv~si~AH~s--------------nCicI-----~f~-------------p~--------------Gr----------- 202 (313)
T KOG1407|consen 180 KPVQSIKAHPS--------------NCICI-----EFD-------------PD--------------GR----------- 202 (313)
T ss_pred ccccccccCCc--------------ceEEE-----EEC-------------CC--------------Cc-----------
Confidence 99999988853 12221 222 11 10
Q ss_pred hhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeE
Q 002446 335 HLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPIS 414 (921)
Q Consensus 335 ~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIs 414 (921)
.++.+..|-.|.+||+...-++..|..|.-||.
T Consensus 203 -----------------------------------------------yfA~GsADAlvSLWD~~ELiC~R~isRldwpVR 235 (313)
T KOG1407|consen 203 -----------------------------------------------YFATGSADALVSLWDVDELICERCISRLDWPVR 235 (313)
T ss_pred -----------------------------------------------eEeeccccceeeccChhHhhhheeeccccCceE
Confidence 122334566799999999999999999999999
Q ss_pred EEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 415 ALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 415 aLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
.|+||.||+|||+||+| +.|-|=++.+| ..+++.+ ..+.-..+||.|...+||-+.+|
T Consensus 236 TlSFS~dg~~lASaSED-h~IDIA~vetG--------------d~~~eI~---~~~~t~tVAWHPk~~LLAyA~dd 293 (313)
T KOG1407|consen 236 TLSFSHDGRMLASASED-HFIDIAEVETG--------------DRVWEIP---CEGPTFTVAWHPKRPLLAYACDD 293 (313)
T ss_pred EEEeccCcceeeccCcc-ceEEeEecccC--------------CeEEEee---ccCCceeEEecCCCceeeEEecC
Confidence 99999999999999999 56888888876 3455553 23457899999999999988765
No 102
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.39 E-value=5e-12 Score=145.64 Aligned_cols=107 Identities=14% Similarity=0.121 Sum_probs=91.2
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
++++..+.+++||-.+++.+..+++|+..|.+|-.++||+.+++||.||+ ||+||+... +++.++
T Consensus 187 vsGgtek~lr~wDprt~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgt-IrlWdLgqQ--------------rCl~T~ 251 (735)
T KOG0308|consen 187 VSGGTEKDLRLWDPRTCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGT-IRLWDLGQQ--------------RCLATY 251 (735)
T ss_pred EecCcccceEEeccccccceeeeeccccceEEEEEcCCCCeEeecCCCce-EEeeecccc--------------ceeeeE
Confidence 45566789999999999999999999999999999999999999999998 999999864 556565
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
. -|... |+++.-+|+=+.+.+|+.||.|..=|+..+.....+
T Consensus 252 ~-vH~e~-VWaL~~~~sf~~vYsG~rd~~i~~Tdl~n~~~~tli 293 (735)
T KOG0308|consen 252 I-VHKEG-VWALQSSPSFTHVYSGGRDGNIYRTDLRNPAKSTLI 293 (735)
T ss_pred E-eccCc-eEEEeeCCCcceEEecCCCCcEEecccCCchhheEe
Confidence 3 33333 999999999999999999999999999987554443
No 103
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.37 E-value=2.4e-11 Score=143.79 Aligned_cols=176 Identities=19% Similarity=0.242 Sum_probs=121.2
Q ss_pred CCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcC---CEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcc
Q 002446 203 SVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSS---RVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIG 278 (921)
Q Consensus 203 ~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~---riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~ 278 (921)
..+.|||||++...+|++++.++.-|.+|+|++ |+++. ++|++|+||++..-+....-+....
T Consensus 387 SMDKTVRLWh~~~~~CL~~F~HndfVTcVaFnPvDDryFiSGSLD~KvRiWsI~d~~Vv~W~Dl~~l------------- 453 (712)
T KOG0283|consen 387 SMDKTVRLWHPGRKECLKVFSHNDFVTCVAFNPVDDRYFISGSLDGKVRLWSISDKKVVDWNDLRDL------------- 453 (712)
T ss_pred cccccEEeecCCCcceeeEEecCCeeEEEEecccCCCcEeecccccceEEeecCcCeeEeehhhhhh-------------
Confidence 356999999999999999999999999999984 66665 9999999999987654333221100
Q ss_pred ccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccc
Q 002446 279 YGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEF 358 (921)
Q Consensus 279 ~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~ 358 (921)
+. | +.|.
T Consensus 454 IT--A-----vcy~------------------------------------------------------------------ 460 (712)
T KOG0283|consen 454 IT--A-----VCYS------------------------------------------------------------------ 460 (712)
T ss_pred he--e-----EEec------------------------------------------------------------------
Confidence 00 0 1121
Q ss_pred cCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEec---------cCCCCeEEEEECCCCC--EEEE
Q 002446 359 LPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFR---------AHKSPISALCFDPSGI--LLVT 427 (921)
Q Consensus 359 ~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~---------aH~~pIsaLaFSPdGt--lLAT 427 (921)
|+|.+. + -+...|.+++|+....+....+. .|. .|+.+.|.|.-. +|+|
T Consensus 461 -PdGk~a-------------v-----IGt~~G~C~fY~t~~lk~~~~~~I~~~~~Kk~~~~-rITG~Q~~p~~~~~vLVT 520 (712)
T KOG0283|consen 461 -PDGKGA-------------V-----IGTFNGYCRFYDTEGLKLVSDFHIRLHNKKKKQGK-RITGLQFFPGDPDEVLVT 520 (712)
T ss_pred -cCCceE-------------E-----EEEeccEEEEEEccCCeEEEeeeEeeccCccccCc-eeeeeEecCCCCCeEEEe
Confidence 222111 1 12446889999988877665543 233 799999998533 6665
Q ss_pred EecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccccc-EEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 428 ASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAV-IQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 428 aS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~-I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|.|-+ |||||..+. ..+.+| +|+.+.. -...+|+.||++|+++|+|.-|+||++...
T Consensus 521 -SnDSr-IRI~d~~~~--------------~lv~Kf-KG~~n~~SQ~~Asfs~Dgk~IVs~seDs~VYiW~~~~~ 578 (712)
T KOG0283|consen 521 -SNDSR-IRIYDGRDK--------------DLVHKF-KGFRNTSSQISASFSSDGKHIVSASEDSWVYIWKNDSF 578 (712)
T ss_pred -cCCCc-eEEEeccch--------------hhhhhh-cccccCCcceeeeEccCCCEEEEeecCceEEEEeCCCC
Confidence 56656 999999653 122233 2332222 346789999999999999999999998654
No 104
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.37 E-value=1.4e-10 Score=123.15 Aligned_cols=181 Identities=14% Similarity=0.173 Sum_probs=124.6
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEE-E-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVA-I-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLA-V-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
++|++||+.+++.++.+.....+..+.++ ++.++ + ..++.|++||+.+++.+..+..+..
T Consensus 11 ~~v~~~d~~t~~~~~~~~~~~~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~~~~~~~~~~~---------------- 74 (300)
T TIGR03866 11 NTISVIDTATLEVTRTFPVGQRPRGITLSKDGKLLYVCASDSDTIQVIDLATGEVIGTLPSGPD---------------- 74 (300)
T ss_pred CEEEEEECCCCceEEEEECCCCCCceEECCCCCEEEEEECCCCeEEEEECCCCcEEEeccCCCC----------------
Confidence 68999999999999999876667788886 45553 3 3567999999999887655432210
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
++.+++.. + |..+
T Consensus 75 ----~~~~~~~~-------------~--------------g~~l------------------------------------ 87 (300)
T TIGR03866 75 ----PELFALHP-------------N--------------GKIL------------------------------------ 87 (300)
T ss_pred ----ccEEEECC-------------C--------------CCEE------------------------------------
Confidence 11223321 0 1100
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
++....++.|++||+.+.+.+..++.+ ..+.+++|+|||++|++++.++..+.+||..
T Consensus 88 ---------------------~~~~~~~~~l~~~d~~~~~~~~~~~~~-~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~ 145 (300)
T TIGR03866 88 ---------------------YIANEDDNLVTVIDIETRKVLAEIPVG-VEPEGMAVSPDGKIVVNTSETTNMAHFIDTK 145 (300)
T ss_pred ---------------------EEEcCCCCeEEEEECCCCeEEeEeeCC-CCcceEEECCCCCEEEEEecCCCeEEEEeCC
Confidence 011233578999999998888888643 3468899999999999999887767888987
Q ss_pred CCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe-CCCcEEEEecCCCCCceeec
Q 002446 442 PGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS-SRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 442 ~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS-~DgTVhVWdi~~~g~~~~l~ 508 (921)
++ ..+..+..+ ..+..++|+|||++|++++ .+++|++||+.+......+.
T Consensus 146 ~~--------------~~~~~~~~~---~~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~ 196 (300)
T TIGR03866 146 TY--------------EIVDNVLVD---QRPRFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKIT 196 (300)
T ss_pred CC--------------eEEEEEEcC---CCccEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeee
Confidence 64 222222222 2367899999999986554 59999999998764444443
No 105
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.36 E-value=1.1e-10 Score=127.71 Aligned_cols=133 Identities=17% Similarity=0.289 Sum_probs=106.1
Q ss_pred cEEEEEECCCCcEEEEEe-CCCCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
..-.+|++.+|+...++. ++..|..+.|| +.+||. .++++|.||+..|+.....+... .+-
T Consensus 86 D~AflW~~~~ge~~~eltgHKDSVt~~~FshdgtlLATGdmsG~v~v~~~stg~~~~~~~~e---------------~~d 150 (399)
T KOG0296|consen 86 DLAFLWDISTGEFAGELTGHKDSVTCCSFSHDGTLLATGDMSGKVLVFKVSTGGEQWKLDQE---------------VED 150 (399)
T ss_pred ceEEEEEccCCcceeEecCCCCceEEEEEccCceEEEecCCCccEEEEEcccCceEEEeecc---------------cCc
Confidence 346799999999888885 68899999997 678888 68899999999999887777521 011
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
| .||-... . +.
T Consensus 151 i----eWl~WHp-------------~--------------a~-------------------------------------- 161 (399)
T KOG0296|consen 151 I----EWLKWHP-------------R--------------AH-------------------------------------- 161 (399)
T ss_pred e----EEEEecc-------------c--------------cc--------------------------------------
Confidence 2 3544321 0 00
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
.++.+..+|.|-+|.+.++...+.|.+|+.++++=.|.|||+.++++..||+ |++|+..
T Consensus 162 --------------------illAG~~DGsvWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~dgt-i~~Wn~k 220 (399)
T KOG0296|consen 162 --------------------ILLAGSTDGSVWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYDDGT-IIVWNPK 220 (399)
T ss_pred --------------------EEEeecCCCcEEEEECCCcceeeEecCCCCCcccccccCCCceEEEEecCce-EEEEecC
Confidence 1223466899999999999999999999999999999999999999999998 8999998
Q ss_pred CC
Q 002446 442 PG 443 (921)
Q Consensus 442 ~g 443 (921)
++
T Consensus 221 tg 222 (399)
T KOG0296|consen 221 TG 222 (399)
T ss_pred CC
Confidence 86
No 106
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.35 E-value=2.8e-10 Score=122.87 Aligned_cols=244 Identities=15% Similarity=0.272 Sum_probs=164.3
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEc--cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGY--RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVR 163 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~--~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~r 163 (921)
..|=.|.-++|-. .. ..++.... ++.+|..++.+ .+....+.+|...|..+.+.|. +|.|
T Consensus 54 skkyG~~~~~Fth---~~---~~~i~sStk~d~tIryLsl~d-NkylRYF~GH~~~V~sL~~sP~-------~d~F---- 115 (311)
T KOG1446|consen 54 SKKYGVDLACFTH---HS---NTVIHSSTKEDDTIRYLSLHD-NKYLRYFPGHKKRVNSLSVSPK-------DDTF---- 115 (311)
T ss_pred cccccccEEEEec---CC---ceEEEccCCCCCceEEEEeec-CceEEEcCCCCceEEEEEecCC-------CCeE----
Confidence 4566788888877 33 13444443 56799999999 5677789999999999999873 2333
Q ss_pred CEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCC-CCEEEEEEcCCEEEEEe
Q 002446 164 PLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFR-SPIYSVRCSSRVVAICQ 242 (921)
Q Consensus 164 PLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~-s~V~sV~~S~riLAVa~ 242 (921)
.+.+ .+++||+||+++.++...+... .+|.+..-.+-++|++.
T Consensus 116 -----lS~S-------------------------------~D~tvrLWDlR~~~cqg~l~~~~~pi~AfDp~GLifA~~~ 159 (311)
T KOG1446|consen 116 -----LSSS-------------------------------LDKTVRLWDLRVKKCQGLLNLSGRPIAAFDPEGLIFALAN 159 (311)
T ss_pred -----Eecc-------------------------------cCCeEEeeEecCCCCceEEecCCCcceeECCCCcEEEEec
Confidence 1111 2378999999999998888875 46665555677888866
Q ss_pred CC-EEEEEECCCCcE-EEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 243 AA-QVHCFDAATLEI-EYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 243 d~-~I~IwDl~T~~~-l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
++ .|++||++.+.. .++.... ..+..+ +|=..- .+|
T Consensus 160 ~~~~IkLyD~Rs~dkgPF~tf~i--------------~~~~~~---ew~~l~-----------FS~-------------- 197 (311)
T KOG1446|consen 160 GSELIKLYDLRSFDKGPFTTFSI--------------TDNDEA---EWTDLE-----------FSP-------------- 197 (311)
T ss_pred CCCeEEEEEecccCCCCceeEcc--------------CCCCcc---ceeeeE-----------EcC--------------
Confidence 55 999999987632 1111100 000000 111100 000
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
+|+.+ .-....+.+.+.|.-+|
T Consensus 198 dGK~i----------------------------------------------------------LlsT~~s~~~~lDAf~G 219 (311)
T KOG1446|consen 198 DGKSI----------------------------------------------------------LLSTNASFIYLLDAFDG 219 (311)
T ss_pred CCCEE----------------------------------------------------------EEEeCCCcEEEEEccCC
Confidence 12111 11133578999999999
Q ss_pred ceEEEeccCCCCe---EEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE
Q 002446 401 NVIAQFRAHKSPI---SALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF 477 (921)
Q Consensus 401 ~~l~~~~aH~~pI---saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF 477 (921)
..+.+|..|...- ...+|+|||+++.+++.||+ |+||++.++ .++..+ +|.....+.++-|
T Consensus 220 ~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~gs~dg~-i~vw~~~tg--------------~~v~~~-~~~~~~~~~~~~f 283 (311)
T KOG1446|consen 220 TVKSTFSGYPNAGNLPLSATFTPDSKFVLSGSDDGT-IHVWNLETG--------------KKVAVL-RGPNGGPVSCVRF 283 (311)
T ss_pred cEeeeEeeccCCCCcceeEEECCCCcEEEEecCCCc-EEEEEcCCC--------------cEeeEe-cCCCCCCcccccc
Confidence 9999999886432 45789999999999999998 899999886 444555 4544556899999
Q ss_pred ccCCCEEEEEeCCCcEEEEecCCC
Q 002446 478 SDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
+|--..+|+++. .+-+|-....
T Consensus 284 nP~~~mf~sa~s--~l~fw~p~~~ 305 (311)
T KOG1446|consen 284 NPRYAMFVSASS--NLVFWLPDED 305 (311)
T ss_pred CCceeeeeecCc--eEEEEecccc
Confidence 998888887754 5777765543
No 107
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=99.34 E-value=7.5e-11 Score=127.35 Aligned_cols=123 Identities=15% Similarity=0.166 Sum_probs=94.4
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc--c
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG--L 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG--~ 467 (921)
..+-||.-..+.++..+-+|.+.|+.|+|-+||..|.+++..--.|-.||+... ...+|.|.|. .
T Consensus 230 q~~giy~~~~~~pl~llggh~gGvThL~~~edGn~lfsGaRk~dkIl~WDiR~~-------------~~pv~~L~rhv~~ 296 (406)
T KOG2919|consen 230 QRVGIYNDDGRRPLQLLGGHGGGVTHLQWCEDGNKLFSGARKDDKILCWDIRYS-------------RDPVYALERHVGD 296 (406)
T ss_pred ceeeeEecCCCCceeeecccCCCeeeEEeccCcCeecccccCCCeEEEEeehhc-------------cchhhhhhhhccC
Confidence 445666667788999999999999999999999999999887667999999874 3456777653 3
Q ss_pred ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCce-eecCCCCCcccccCCcCCccccCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSV-NFQPTDANFTTKHGAMAKSGVRWP 529 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~-~l~~H~~~~~~~~~~~~~~~~r~~ 529 (921)
|+.+|+ ....|+|+|||+|+.||.|++||+..++..+ .+..|...++ +.+++++.+..
T Consensus 297 TNQRI~-FDld~~~~~LasG~tdG~V~vwdlk~~gn~~sv~~~~sd~vN---gvslnP~mpil 355 (406)
T KOG2919|consen 297 TNQRIL-FDLDPKGEILASGDTDGSVRVWDLKDLGNEVSVTGNYSDTVN---GVSLNPIMPIL 355 (406)
T ss_pred ccceEE-EecCCCCceeeccCCCccEEEEecCCCCCccccccccccccc---ceecCccccee
Confidence 343444 3447999999999999999999999988855 4466766666 45555554333
No 108
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.33 E-value=7.1e-11 Score=132.19 Aligned_cols=227 Identities=20% Similarity=0.323 Sum_probs=160.5
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
.|-.+|+.+.... |+ ++|+.|- ++-|+|||+++. +....+..|.+.|..+.|--.+ ..
T Consensus 200 ~h~keil~~avS~---Dg----kylatgg~d~~v~Iw~~~t~-ehv~~~~ghr~~V~~L~fr~gt-------------~~ 258 (479)
T KOG0299|consen 200 GHVKEILTLAVSS---DG----KYLATGGRDRHVQIWDCDTL-EHVKVFKGHRGAVSSLAFRKGT-------------SE 258 (479)
T ss_pred cccceeEEEEEcC---CC----cEEEecCCCceEEEecCccc-chhhcccccccceeeeeeecCc-------------cc
Confidence 6777888888766 66 6777665 666899999994 5566788899999998875321 12
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEE-eCCCCEEEEEEc--CCEEEE-
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHML-KFRSPIYSVRCS--SRVVAI- 240 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL-~f~s~V~sV~~S--~riLAV- 240 (921)
|.+.+. +.+|++|++..-.++.++ .+.+.|.+|... .|.+.|
T Consensus 259 lys~s~----------------------------------Drsvkvw~~~~~s~vetlyGHqd~v~~IdaL~reR~vtVG 304 (479)
T KOG0299|consen 259 LYSASA----------------------------------DRSVKVWSIDQLSYVETLYGHQDGVLGIDALSRERCVTVG 304 (479)
T ss_pred eeeeec----------------------------------CCceEEEehhHhHHHHHHhCCccceeeechhcccceEEec
Confidence 332222 267999999998888876 457899999985 467777
Q ss_pred EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccC
Q 002446 241 CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFAS 320 (921)
Q Consensus 241 a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s 320 (921)
.-|.++++|++..-..+ ....+. ++ + ..+||-
T Consensus 305 grDrT~rlwKi~eesql-ifrg~~---~s------------i----dcv~~I---------------------------- 336 (479)
T KOG0299|consen 305 GRDRTVRLWKIPEESQL-IFRGGE---GS------------I----DCVAFI---------------------------- 336 (479)
T ss_pred cccceeEEEecccccee-eeeCCC---CC------------e----eeEEEe----------------------------
Confidence 47899999998432111 000100 00 0 001111
Q ss_pred CCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC
Q 002446 321 NGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK 400 (921)
Q Consensus 321 ~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~ 400 (921)
. ..||+++..+|.|.+|++..+
T Consensus 337 -----------------------n-----------------------------------~~HfvsGSdnG~IaLWs~~KK 358 (479)
T KOG0299|consen 337 -----------------------N-----------------------------------DEHFVSGSDNGSIALWSLLKK 358 (479)
T ss_pred -----------------------c-----------------------------------ccceeeccCCceEEEeeeccc
Confidence 0 025667788999999999999
Q ss_pred ceEEEec-cCC-----------CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 401 NVIAQFR-AHK-----------SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 401 ~~l~~~~-aH~-----------~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
+++.+.+ +|. .-|++|+.-|...++|++|.+|. +|+|.+.++. .....++.+. .
T Consensus 359 kplf~~~~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS~~G~-vrLW~i~~g~----------r~i~~l~~ls--~- 424 (479)
T KOG0299|consen 359 KPLFTSRLAHGVIPELDPVNGNFWITSLAVIPGSDLLASGSWSGC-VRLWKIEDGL----------RAINLLYSLS--L- 424 (479)
T ss_pred CceeEeeccccccCCccccccccceeeeEecccCceEEecCCCCc-eEEEEecCCc----------cccceeeecc--c-
Confidence 9988876 663 26899999999999999999997 9999999861 1234455553 1
Q ss_pred cccEEEEEEccCCCEEEEE
Q 002446 469 NAVIQDISFSDDSNWIMIS 487 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsg 487 (921)
...|++|+|+++|++|.+|
T Consensus 425 ~GfVNsl~f~~sgk~ivag 443 (479)
T KOG0299|consen 425 VGFVNSLAFSNSGKRIVAG 443 (479)
T ss_pred ccEEEEEEEccCCCEEEEe
Confidence 2349999999999988777
No 109
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.33 E-value=3.1e-10 Score=121.82 Aligned_cols=257 Identities=13% Similarity=0.171 Sum_probs=169.1
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCe-EEeeeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNV-HDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~-~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
.+..|.|.-+.|.+ .. ..+|+.|. ++.+|+|+++..+.. -+....++|||-++.+.-+
T Consensus 24 ~pP~DsIS~l~FSP---~~---~~~~~A~SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~Wsdd-------------- 83 (347)
T KOG0647|consen 24 NPPEDSISALAFSP---QA---DNLLAAGSWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDD-------------- 83 (347)
T ss_pred CCcccchheeEecc---cc---CceEEecccCCceEEEEEecCCcccchhhhccCCCeEEEEEccC--------------
Confidence 35678999999998 22 14665666 777999999985322 1223356777777776532
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc----CCEE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS----SRVV 238 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S----~riL 238 (921)
...+. .++ .++.+++|||.+++....--+..+|..++|= -..|
T Consensus 84 gskVf-~g~--------------------------------~Dk~~k~wDL~S~Q~~~v~~Hd~pvkt~~wv~~~~~~cl 130 (347)
T KOG0647|consen 84 GSKVF-SGG--------------------------------CDKQAKLWDLASGQVSQVAAHDAPVKTCHWVPGMNYQCL 130 (347)
T ss_pred CceEE-eec--------------------------------cCCceEEEEccCCCeeeeeecccceeEEEEecCCCccee
Confidence 11111 111 2267999999999887777788999999993 2466
Q ss_pred EE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccc
Q 002446 239 AI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSG 317 (921)
Q Consensus 239 AV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~ 317 (921)
+. +-|++|+.||.+....+.++.- |. | .|+
T Consensus 131 ~TGSWDKTlKfWD~R~~~pv~t~~L-------Pe---------------R--vYa------------------------- 161 (347)
T KOG0647|consen 131 VTGSWDKTLKFWDTRSSNPVATLQL-------PE---------------R--VYA------------------------- 161 (347)
T ss_pred EecccccceeecccCCCCeeeeeec-------cc---------------e--eee-------------------------
Confidence 76 7899999999998777776642 10 0 011
Q ss_pred ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEEC
Q 002446 318 FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDI 397 (921)
Q Consensus 318 ~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl 397 (921)
.+.-+.++ +-+..+..|.+|.+
T Consensus 162 ------------~Dv~~pm~----------------------------------------------vVata~r~i~vynL 183 (347)
T KOG0647|consen 162 ------------ADVLYPMA----------------------------------------------VVATAERHIAVYNL 183 (347)
T ss_pred ------------hhccCcee----------------------------------------------EEEecCCcEEEEEc
Confidence 00000000 00112345778888
Q ss_pred CCCceEEEeccCCC----CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc----c-
Q 002446 398 VSKNVIAQFRAHKS----PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL----T- 468 (921)
Q Consensus 398 ~s~~~l~~~~aH~~----pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~----t- 468 (921)
+++. ..++.|.+ -+.||+.-+|....|.||.+|+ +-|..+..+.. ...-.++.+|.. .
T Consensus 184 ~n~~--te~k~~~SpLk~Q~R~va~f~d~~~~alGsiEGr-v~iq~id~~~~----------~~nFtFkCHR~~~~~~~~ 250 (347)
T KOG0647|consen 184 ENPP--TEFKRIESPLKWQTRCVACFQDKDGFALGSIEGR-VAIQYIDDPNP----------KDNFTFKCHRSTNSVNDD 250 (347)
T ss_pred CCCc--chhhhhcCcccceeeEEEEEecCCceEeeeecce-EEEEecCCCCc----------cCceeEEEeccCCCCCCc
Confidence 7653 34555544 4778888888888899999998 78988887411 112345556621 1
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCc
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANF 514 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~ 514 (921)
-..|++|+|.|.-..|++++.|||.-.||-.....+.+...|...+
T Consensus 251 VYaVNsi~FhP~hgtlvTaGsDGtf~FWDkdar~kLk~s~~~~qpI 296 (347)
T KOG0647|consen 251 VYAVNSIAFHPVHGTLVTAGSDGTFSFWDKDARTKLKTSETHPQPI 296 (347)
T ss_pred eEEecceEeecccceEEEecCCceEEEecchhhhhhhccCcCCCcc
Confidence 1238899999999999999999999999987766666666664433
No 110
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.30 E-value=2.6e-11 Score=134.02 Aligned_cols=240 Identities=13% Similarity=0.217 Sum_probs=149.6
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeee-eecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVS-RYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS-~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
...+|...|.++.|.+ |+ |.+|+.|.+.-+.+||+.+ |+.+..+. .+.-.|.++...|+ .|+
T Consensus 264 tlvgh~~~V~yi~wSP---Dd---ryLlaCg~~e~~~lwDv~t-gd~~~~y~~~~~~S~~sc~W~pD---------g~~- 326 (519)
T KOG0293|consen 264 TLVGHSQPVSYIMWSP---DD---RYLLACGFDEVLSLWDVDT-GDLRHLYPSGLGFSVSSCAWCPD---------GFR- 326 (519)
T ss_pred eeecccCceEEEEECC---CC---CeEEecCchHheeeccCCc-chhhhhcccCcCCCcceeEEccC---------Cce-
Confidence 4458899999999998 65 5777788888899999998 56655554 33556788888874 221
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC--CCCEEEEEEc--C-C
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF--RSPIYSVRCS--S-R 236 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f--~s~V~sV~~S--~-r 236 (921)
++.++ +| +++..||+.. +.+...+. .-.|++++++ + .
T Consensus 327 ------~V~Gs--------~d-----------------------r~i~~wdlDg-n~~~~W~gvr~~~v~dlait~Dgk~ 368 (519)
T KOG0293|consen 327 ------FVTGS--------PD-----------------------RTIIMWDLDG-NILGNWEGVRDPKVHDLAITYDGKY 368 (519)
T ss_pred ------eEecC--------CC-----------------------CcEEEecCCc-chhhcccccccceeEEEEEcCCCcE
Confidence 23332 12 6788999864 43444443 2468999986 3 5
Q ss_pred EEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC--ceEE--ecCCCceecCCCccCCcccccc
Q 002446 237 VVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLA--YSGSPVVVSNDGRVNPQHLMQS 312 (921)
Q Consensus 237 iLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLA--yas~~~~~s~~GrvsPq~l~~s 312 (921)
+++|..+..|++|+..+..+...+..+.. .-.+.++. ++.- .....+..|..
T Consensus 369 vl~v~~d~~i~l~~~e~~~dr~lise~~~-------------its~~iS~d~k~~LvnL~~qei~LWDl----------- 424 (519)
T KOG0293|consen 369 VLLVTVDKKIRLYNREARVDRGLISEEQP-------------ITSFSISKDGKLALVNLQDQEIHLWDL----------- 424 (519)
T ss_pred EEEEecccceeeechhhhhhhccccccCc-------------eeEEEEcCCCcEEEEEcccCeeEEeec-----------
Confidence 66778999999999988765433333211 01122211 1111 11111112210
Q ss_pred cccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEE
Q 002446 313 RSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMV 392 (921)
Q Consensus 313 ~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V 392 (921)
+.-|. . .++.|.. ...|. + .+++. |.-..-++++..|++|
T Consensus 425 ------------------~e~~l-v--~kY~Ghk----q~~fi----------I--rSCFg---g~~~~fiaSGSED~kv 464 (519)
T KOG0293|consen 425 ------------------EENKL-V--RKYFGHK----QGHFI----------I--RSCFG---GGNDKFIASGSEDSKV 464 (519)
T ss_pred ------------------chhhH-H--HHhhccc----ccceE----------E--EeccC---CCCcceEEecCCCceE
Confidence 00000 0 0111211 11111 0 11110 0001234578899999
Q ss_pred EEEECCCCceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCC
Q 002446 393 IVRDIVSKNVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 393 ~IwDl~s~~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~ 442 (921)
+||+..++++++.+.+|...|.|++++| |-.+||+||+||| ||||-..+
T Consensus 465 yIWhr~sgkll~~LsGHs~~vNcVswNP~~p~m~ASasDDgt-IRIWg~~~ 514 (519)
T KOG0293|consen 465 YIWHRISGKLLAVLSGHSKTVNCVSWNPADPEMFASASDDGT-IRIWGPSD 514 (519)
T ss_pred EEEEccCCceeEeecCCcceeeEEecCCCCHHHhhccCCCCe-EEEecCCc
Confidence 9999999999999999999999999999 5679999999998 99997764
No 111
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=99.30 E-value=1.7e-10 Score=124.34 Aligned_cols=257 Identities=17% Similarity=0.232 Sum_probs=166.6
Q ss_pred EEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEE
Q 002446 91 VLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFC 169 (921)
Q Consensus 91 V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv 169 (921)
-..+.|++ -| ..|++|+.+| +.|||..+.+ +..+++.|--||.++..+++ -|-||. .
T Consensus 26 a~~~~Fs~---~G----~~lAvGc~nG~vvI~D~~T~~-iar~lsaH~~pi~sl~WS~d-------------gr~Llt-s 83 (405)
T KOG1273|consen 26 AECCQFSR---WG----DYLAVGCANGRVVIYDFDTFR-IARMLSAHVRPITSLCWSRD-------------GRKLLT-S 83 (405)
T ss_pred cceEEecc---Cc----ceeeeeccCCcEEEEEccccc-hhhhhhccccceeEEEecCC-------------CCEeee-e
Confidence 56788888 44 5999999887 8999999964 66789999999999999864 133442 2
Q ss_pred eCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcC----CEEEEEeCCE
Q 002446 170 ADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSS----RVVAICQAAQ 245 (921)
Q Consensus 170 ~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~----riLAVa~d~~ 245 (921)
+. | ..|++||+..|.+++.++|+++|+...+-+ +.||.-.+..
T Consensus 84 S~----------D-----------------------~si~lwDl~~gs~l~rirf~spv~~~q~hp~k~n~~va~~~~~s 130 (405)
T KOG1273|consen 84 SR----------D-----------------------WSIKLWDLLKGSPLKRIRFDSPVWGAQWHPRKRNKCVATIMEES 130 (405)
T ss_pred cC----------C-----------------------ceeEEEeccCCCceeEEEccCccceeeeccccCCeEEEEEecCC
Confidence 11 2 569999999999999999999999999953 2333333333
Q ss_pred EEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcce
Q 002446 246 VHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRV 325 (921)
Q Consensus 246 I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~V 325 (921)
-.+-++... ++++. +-.+. ..++.++ +.|
T Consensus 131 p~vi~~s~~--~h~~L----------------------------p~d~d------------~dln~sa------s~~--- 159 (405)
T KOG1273|consen 131 PVVIDFSDP--KHSVL----------------------------PKDDD------------GDLNSSA------SHG--- 159 (405)
T ss_pred cEEEEecCC--ceeec----------------------------cCCCc------------ccccccc------ccc---
Confidence 333333321 12211 10000 0000000 000
Q ss_pred eehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEE
Q 002446 326 AHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQ 405 (921)
Q Consensus 326 a~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~ 405 (921)
.|.+ + ..++.++...|++.|||..+.++++.
T Consensus 160 ---------------------~fdr-----------------------~-----g~yIitGtsKGkllv~~a~t~e~vas 190 (405)
T KOG1273|consen 160 ---------------------VFDR-----------------------R-----GKYIITGTSKGKLLVYDAETLECVAS 190 (405)
T ss_pred ---------------------cccC-----------------------C-----CCEEEEecCcceEEEEecchheeeee
Confidence 0000 0 01234556679999999999999999
Q ss_pred eccCC-CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCC-CCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCE
Q 002446 406 FRAHK-SPISALCFDPSGILLVTASVQGHNINIFKIIPGI-LGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNW 483 (921)
Q Consensus 406 ~~aH~-~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~-~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~ 483 (921)
|+--+ ..|..+-|+..|+.|++-..|. +||+|++..-- .+. . ......+++.--.....-.+++||.||.|
T Consensus 191 ~rits~~~IK~I~~s~~g~~liiNtsDR-vIR~ye~~di~~~~r--~----~e~e~~~K~qDvVNk~~Wk~ccfs~dgeY 263 (405)
T KOG1273|consen 191 FRITSVQAIKQIIVSRKGRFLIINTSDR-VIRTYEISDIDDEGR--D----GEVEPEHKLQDVVNKLQWKKCCFSGDGEY 263 (405)
T ss_pred eeechheeeeEEEEeccCcEEEEecCCc-eEEEEehhhhcccCc--c----CCcChhHHHHHHHhhhhhhheeecCCccE
Confidence 99776 8999999999999999999995 69999987420 111 0 11222233322222233678999999999
Q ss_pred EEEEeCC-CcEEEEecCCCCCceeecC
Q 002446 484 IMISSSR-GTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 484 LAsgS~D-gTVhVWdi~~~g~~~~l~~ 509 (921)
++.+|.+ ..++||.-..+.-...+.|
T Consensus 264 v~a~s~~aHaLYIWE~~~GsLVKILhG 290 (405)
T KOG1273|consen 264 VCAGSARAHALYIWEKSIGSLVKILHG 290 (405)
T ss_pred EEeccccceeEEEEecCCcceeeeecC
Confidence 9887754 4689999876544444444
No 112
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=99.29 E-value=1.7e-10 Score=133.71 Aligned_cols=311 Identities=18% Similarity=0.205 Sum_probs=179.5
Q ss_pred CeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEE-ecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCc
Q 002446 107 RRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQM-LPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGL 184 (921)
Q Consensus 107 ~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~-lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~ 184 (921)
.+++++|+..| +|+|+-++..-+..+-..|--.+-.... .|+|+.+......|.+ .+|+.++.+. |..
T Consensus 270 ~r~I~cgCa~g~vrlFnp~tL~y~~Tlpr~halg~d~a~~~q~~~~~s~~~~a~fPD---~IA~~Fdet~-------~kl 339 (1080)
T KOG1408|consen 270 SRLIACGCAKGMVRLFNPETLDYAGTLPRSHALGSDTANLSQPEPKNSESSPAIFPD---AIACQFDETT-------DKL 339 (1080)
T ss_pred cceEEEeeccceeeecCcchhhhccccccccccccchhhcccccccccccCcccCCc---eeEEEecCCC-------ceE
Confidence 36778888766 6999998864333322223222222222 3666666555556643 5788887431 211
Q ss_pred ccccCCCCCCcCCCCCCCCCCcEEEEEECCCC----cEEEEEeCCCCEEEEEE---c----------C-CEEEEEeCCEE
Q 002446 185 ATACNGTSANYHDLGNGSSVPTVVHFYSLRSQ----SYVHMLKFRSPIYSVRC---S----------S-RVVAICQAAQV 246 (921)
Q Consensus 185 ~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg----~~V~tL~f~s~V~sV~~---S----------~-riLAVa~d~~I 246 (921)
...|.++.+.+||++.- ++-..|-+.+.|++|+. + + -++..+.|++|
T Consensus 340 ---------------scVYndhSlYvWDvrD~~kvgk~~s~lyHS~ciW~Ve~~p~nv~~~~~aclp~~cF~TCSsD~TI 404 (1080)
T KOG1408|consen 340 ---------------SCVYNDHSLYVWDVRDVNKVGKCSSMLYHSACIWDVENLPCNVHSPTAACLPRGCFTTCSSDGTI 404 (1080)
T ss_pred ---------------EEEEcCceEEEEeccccccccceeeeeeccceeeeeccccccccCcccccCCccceeEecCCCcE
Confidence 12345588999999764 44455666778888876 1 1 24445789999
Q ss_pred EEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCccee
Q 002446 247 HCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVA 326 (921)
Q Consensus 247 ~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va 326 (921)
++||+.....-.++...... -+. --+.|.+.... .+ +....+. +
T Consensus 405 RlW~l~~ctnn~vyrRNils------------~~l-----~ki~y~d~~~q-----~~---~d~~~~~-------f---- 448 (1080)
T KOG1408|consen 405 RLWDLAFCTNNQVYRRNILS------------ANL-----SKIPYEDSTQQ-----IM---HDASAGI-------F---- 448 (1080)
T ss_pred EEeecccccccceeecccch------------hhh-----hcCccccCchh-----hh---hhccCCc-------c----
Confidence 99999864333332221100 000 01223322110 00 0000000 0
Q ss_pred ehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEe
Q 002446 327 HYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQF 406 (921)
Q Consensus 327 ~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~ 406 (921)
.|.+++- .-+..|+..+ ..+|. ..|+++++.-|.++|||+...+....+
T Consensus 449 ------dka~~s~--~d~r~G~R~~----------------~vSp~-------gqhLAsGDr~GnlrVy~Lq~l~~~~~~ 497 (1080)
T KOG1408|consen 449 ------DKALVST--CDSRFGFRAL----------------AVSPD-------GQHLASGDRGGNLRVYDLQELEYTCFM 497 (1080)
T ss_pred ------cccchhh--cCcccceEEE----------------EECCC-------cceecccCccCceEEEEehhhhhhhhe
Confidence 0111100 0011111110 01111 137788888999999999999999999
Q ss_pred ccCCCCeEEEEECC---CCCEEEEEecCCCEEEEEeCCCCCC------CCCCc-----c-CCCCcee--------E----
Q 002446 407 RAHKSPISALCFDP---SGILLVTASVQGHNINIFKIIPGIL------GTSSA-----C-DAGTSYV--------H---- 459 (921)
Q Consensus 407 ~aH~~pIsaLaFSP---dGtlLATaS~DGt~IrIWdi~~g~~------~~~s~-----~-~~~~~~~--------~---- 459 (921)
.+|.+.|.||.||. .-++||+||.| +.|+|||+..... +.+++ + ......+ .
T Consensus 498 eAHesEilcLeyS~p~~~~kLLASasrd-RlIHV~Dv~rny~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr 576 (1080)
T KOG1408|consen 498 EAHESEILCLEYSFPVLTNKLLASASRD-RLIHVYDVKRNYDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFR 576 (1080)
T ss_pred ecccceeEEEeecCchhhhHhhhhccCC-ceEEEEecccccchhhhhcccccceeEEEEeecCCceEEEeccCchhhhee
Confidence 99999999999997 36799999998 5799999986521 21111 0 0000000 0
Q ss_pred -------EEEEeccccc---ccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 460 -------LYRLQRGLTN---AVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 460 -------l~~l~RG~t~---a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
...+.|+++. ..+++++..|..++++++..|..|+||++..++....|++-
T Consensus 577 ~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~sgKq~k~FKgs 637 (1080)
T KOG1408|consen 577 VNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQDRNIRIFDIESGKQVKSFKGS 637 (1080)
T ss_pred hhccccCceeccccccccccceEEEeeeCCCcceEEEEecccceEEEeccccceeeeeccc
Confidence 0012233221 23999999999999999999999999999998888888553
No 113
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.29 E-value=1.2e-10 Score=122.04 Aligned_cols=265 Identities=17% Similarity=0.214 Sum_probs=174.8
Q ss_pred CCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCC--CeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 84 DESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEAD--NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 84 ~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~--~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
++.|+|.|.-+-.|- -| .++...+.+..++||.+.+.+ .....+..|.|||.-+.+.. |.+
T Consensus 7 dt~H~D~IHda~lDy---yg---krlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wah-Pk~---------- 69 (299)
T KOG1332|consen 7 DTQHEDMIHDAQLDY---YG---KRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAH-PKF---------- 69 (299)
T ss_pred hhhhhhhhhHhhhhh---hc---ceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecc-ccc----------
Confidence 467888888777666 44 356666667779999999876 34455678999999988863 322
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC---CCCEEEEEEc----
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF---RSPIYSVRCS---- 234 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f---~s~V~sV~~S---- 234 (921)
..+||.|.- +++|.||.-.+|+--+...| .+.|.+|++-
T Consensus 70 -G~iLAScsY---------------------------------DgkVIiWke~~g~w~k~~e~~~h~~SVNsV~waphey 115 (299)
T KOG1332|consen 70 -GTILASCSY---------------------------------DGKVIIWKEENGRWTKAYEHAAHSASVNSVAWAPHEY 115 (299)
T ss_pred -CcEeeEeec---------------------------------CceEEEEecCCCchhhhhhhhhhcccceeeccccccc
Confidence 367887763 26799999999865554444 6789999995
Q ss_pred CCEEEE-EeCCEEEEEECCCC-cE-EEEE-ecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccc
Q 002446 235 SRVVAI-CQAAQVHCFDAATL-EI-EYAI-LTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLM 310 (921)
Q Consensus 235 ~riLAV-a~d~~I~IwDl~T~-~~-l~tL-~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~ 310 (921)
+-+||. +.|++|.|++..+- .- ...+ ..|+ ++++.++ .+ |...
T Consensus 116 gl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~------------~GvnsVs-------wa-------------pa~~- 162 (299)
T KOG1332|consen 116 GLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHE------------IGVNSVS-------WA-------------PASA- 162 (299)
T ss_pred ceEEEEeeCCCcEEEEEEcCCCCccchhhhhccc------------cccceee-------ec-------------CcCC-
Confidence 356666 78999999987753 21 1111 1121 2333332 11 1100
Q ss_pred cccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCC
Q 002446 311 QSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVG 390 (921)
Q Consensus 311 ~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G 390 (921)
.|+++-+ ..++ + ...+++++.|.
T Consensus 163 ----------~g~~~~~-------~~~~-----------------------------------~-----~krlvSgGcDn 185 (299)
T KOG1332|consen 163 ----------PGSLVDQ-------GPAA-----------------------------------K-----VKRLVSGGCDN 185 (299)
T ss_pred ----------Ccccccc-------Cccc-----------------------------------c-----cceeeccCCcc
Confidence 0111100 0000 0 01245677889
Q ss_pred EEEEEECCCCc--eEEEeccCCCCeEEEEECCCC----CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 391 MVIVRDIVSKN--VIAQFRAHKSPISALCFDPSG----ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 391 ~V~IwDl~s~~--~l~~~~aH~~pIsaLaFSPdG----tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
.|+||+..+++ .-.+|++|+.-|..+++.|.- .+||+||.||+ +.||..... .. .+ ....+.+
T Consensus 186 ~VkiW~~~~~~w~~e~~l~~H~dwVRDVAwaP~~gl~~s~iAS~SqDg~-viIwt~~~e-~e-----~w--k~tll~~-- 254 (299)
T KOG1332|consen 186 LVKIWKFDSDSWKLERTLEGHKDWVRDVAWAPSVGLPKSTIASCSQDGT-VIIWTKDEE-YE-----PW--KKTLLEE-- 254 (299)
T ss_pred ceeeeecCCcchhhhhhhhhcchhhhhhhhccccCCCceeeEEecCCCc-EEEEEecCc-cC-----cc--ccccccc--
Confidence 99999998863 445699999999999999974 47999999998 789987632 10 01 0111222
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCC
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
+. ..++.++||+.|..||++..|+.|.+|.=+-.|+
T Consensus 255 --f~-~~~w~vSWS~sGn~LaVs~GdNkvtlwke~~~Gk 290 (299)
T KOG1332|consen 255 --FP-DVVWRVSWSLSGNILAVSGGDNKVTLWKENVDGK 290 (299)
T ss_pred --CC-cceEEEEEeccccEEEEecCCcEEEEEEeCCCCc
Confidence 22 2499999999999999999999999998765544
No 114
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.28 E-value=7.9e-09 Score=116.93 Aligned_cols=312 Identities=14% Similarity=0.223 Sum_probs=178.7
Q ss_pred CCcEEEEEEecccCCCCCCCeEEEEEccC--cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 88 HDQVLWAGFDKLESEAGATRRVLLLGYRS--GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 88 kd~V~w~~Fd~~~~d~~~~~~vLllG~~~--GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
.-.|..+.|.++.... .++++-+.+ =+-|||-.-....-+ ++--+..|..+++.|. .++|
T Consensus 154 ~~GV~~vaFsk~~~G~----~l~~vD~s~~h~lSVWdWqk~~~~~~-vk~sne~v~~a~FHPt-------------d~nl 215 (626)
T KOG2106|consen 154 DRGVTCVAFSKINGGS----LLCAVDDSNPHMLSVWDWQKKAKLGP-VKTSNEVVFLATFHPT-------------DPNL 215 (626)
T ss_pred cccceeeeecccCCCc----eEEEecCCCccccchhhchhhhccCc-ceeccceEEEEEeccC-------------CCcE
Confidence 3458888998854332 455555544 368999976322222 2334556777888874 2466
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-C----CCCEEEEEEc--CCEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-F----RSPIYSVRCS--SRVV 238 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f----~s~V~sV~~S--~riL 238 (921)
+..|+. +.+.||+++++.+++... | +..|.+|.|. +++|
T Consensus 216 iit~Gk----------------------------------~H~~Fw~~~~~~l~k~~~~fek~ekk~Vl~v~F~engdvi 261 (626)
T KOG2106|consen 216 IITCGK----------------------------------GHLYFWTLRGGSLVKRQGIFEKREKKFVLCVTFLENGDVI 261 (626)
T ss_pred EEEeCC----------------------------------ceEEEEEccCCceEEEeeccccccceEEEEEEEcCCCCEE
Confidence 666653 458999999998887653 2 3579999994 6777
Q ss_pred EEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC-ceEEecCCC--ceecCCCc--cCCccccccc
Q 002446 239 AICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP-RWLAYSGSP--VVVSNDGR--VNPQHLMQSR 313 (921)
Q Consensus 239 AVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp-RwLAyas~~--~~~s~~Gr--vsPq~l~~s~ 313 (921)
..-.++.|.||+..+.+..++...|+.- + +.-+.+.. ..|. .+++ +..|...- +.+-.++.
T Consensus 262 TgDS~G~i~Iw~~~~~~~~k~~~aH~gg----------v-~~L~~lr~GtllS-GgKDRki~~Wd~~y~k~r~~elPe-- 327 (626)
T KOG2106|consen 262 TGDSGGNILIWSKGTNRISKQVHAHDGG----------V-FSLCMLRDGTLLS-GGKDRKIILWDDNYRKLRETELPE-- 327 (626)
T ss_pred eecCCceEEEEeCCCceEEeEeeecCCc----------e-EEEEEecCccEee-cCccceEEeccccccccccccCch--
Confidence 7778899999999988877777666421 0 00111111 2222 2222 22332100 00000100
Q ss_pred ccccccCCCcceeehhhhcchhhcceeEecCCcccccccccccc-c--cCCCcCCcc--c-ccCCCCCCCcccCcccccC
Q 002446 314 SFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSE-F--LPDSQNSLQ--S-AIPGGKSNGTVNGHFPDAD 387 (921)
Q Consensus 314 ~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~-~--~p~~~~si~--s-a~~~~k~~g~v~g~~~s~~ 387 (921)
..|. +..+|..-+ + ..+|-..-.-|...+.. + +-.+++.-. . ..|+ ...+++++
T Consensus 328 ------~~G~-iRtv~e~~~-----d-i~vGTtrN~iL~Gt~~~~f~~~v~gh~delwgla~hps-------~~q~~T~g 387 (626)
T KOG2106|consen 328 ------QFGP-IRTVAEGKG-----D-ILVGTTRNFILQGTLENGFTLTVQGHGDELWGLATHPS-------KNQLLTCG 387 (626)
T ss_pred ------hcCC-eeEEecCCC-----c-EEEeeccceEEEeeecCCceEEEEecccceeeEEcCCC-------hhheeecc
Confidence 0010 000010000 0 11221110000000000 0 000000000 0 0111 12456788
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.++.|++|+ ..+++.+.. -..|+.|+.|+|.| .||.+...|+ --|.|+.+. .+.+++.-
T Consensus 388 qdk~v~lW~--~~k~~wt~~-~~d~~~~~~fhpsg-~va~Gt~~G~-w~V~d~e~~---------------~lv~~~~d- 446 (626)
T KOG2106|consen 388 QDKHVRLWN--DHKLEWTKI-IEDPAECADFHPSG-VVAVGTATGR-WFVLDTETQ---------------DLVTIHTD- 446 (626)
T ss_pred CcceEEEcc--CCceeEEEE-ecCceeEeeccCcc-eEEEeeccce-EEEEecccc---------------eeEEEEec-
Confidence 999999999 444544332 34689999999999 8999999998 568888763 34455433
Q ss_pred ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
++.+..++|||||.+||+||.|+.|.||.++..|.....
T Consensus 447 -~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs~~g~~y~r 485 (626)
T KOG2106|consen 447 -NEQLSVVRYSPDGAFLAVGSHDNHIYIYRVSANGRKYSR 485 (626)
T ss_pred -CCceEEEEEcCCCCEEEEecCCCeEEEEEECCCCcEEEE
Confidence 567999999999999999999999999999988776544
No 115
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.26 E-value=2.5e-10 Score=122.10 Aligned_cols=111 Identities=16% Similarity=0.246 Sum_probs=83.3
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe-c
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ-R 465 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~-R 465 (921)
.+-.|++-|+.+|..-+++.+|...|.++.|+|... .|||||.||+ ||+||+... .++...-+.... +..-.++ +
T Consensus 166 r~~~VrLCDi~SGs~sH~LsGHr~~vlaV~Wsp~~e~vLatgsaDg~-irlWDiRra-sgcf~~lD~hn~-k~~p~~~~n 242 (397)
T KOG4283|consen 166 RDVQVRLCDIASGSFSHTLSGHRDGVLAVEWSPSSEWVLATGSADGA-IRLWDIRRA-SGCFRVLDQHNT-KRPPILKTN 242 (397)
T ss_pred CCCcEEEEeccCCcceeeeccccCceEEEEeccCceeEEEecCCCce-EEEEEeecc-cceeEEeecccC-ccCcccccc
Confidence 345799999999999999999999999999999876 5899999998 999999864 111100000000 0000111 2
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
-.+..+|..+||+.|+.++++.+.|..+++|....+
T Consensus 243 ~ah~gkvngla~tSd~~~l~~~gtd~r~r~wn~~~G 278 (397)
T KOG4283|consen 243 TAHYGKVNGLAWTSDARYLASCGTDDRIRVWNMESG 278 (397)
T ss_pred ccccceeeeeeecccchhhhhccCccceEEeecccC
Confidence 334456999999999999999999999999998775
No 116
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.25 E-value=9.7e-11 Score=126.25 Aligned_cols=132 Identities=15% Similarity=0.268 Sum_probs=87.3
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCC-----C--C--ccC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGT-----S--S--ACD 452 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~-----~--s--~~~ 452 (921)
++.++..||.|.+||...-.++.+|++|++.|+.|+..|+|++-.+-+.|+. +|.|++..+..+- . . ...
T Consensus 99 hLlS~sdDG~i~iw~~~~W~~~~slK~H~~~Vt~lsiHPS~KLALsVg~D~~-lr~WNLV~Gr~a~v~~L~~~at~v~w~ 177 (362)
T KOG0294|consen 99 HLLSGSDDGHIIIWRVGSWELLKSLKAHKGQVTDLSIHPSGKLALSVGGDQV-LRTWNLVRGRVAFVLNLKNKATLVSWS 177 (362)
T ss_pred heeeecCCCcEEEEEcCCeEEeeeecccccccceeEecCCCceEEEEcCCce-eeeehhhcCccceeeccCCcceeeEEc
Confidence 4556778999999999999999999999999999999999999999999986 9999999872100 0 0 000
Q ss_pred CCCc--------eeEEEEEe------cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 453 AGTS--------YVHLYRLQ------RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 453 ~~~~--------~~~l~~l~------RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
+.+. ...+|.+. +-....+|.++.|- ++..|++|.++++|.+||-+.......+.+|...+.
T Consensus 178 ~~Gd~F~v~~~~~i~i~q~d~A~v~~~i~~~~r~l~~~~l-~~~~L~vG~d~~~i~~~D~ds~~~~~~~~AH~~RVK 253 (362)
T KOG0294|consen 178 PQGDHFVVSGRNKIDIYQLDNASVFREIENPKRILCATFL-DGSELLVGGDNEWISLKDTDSDTPLTEFLAHENRVK 253 (362)
T ss_pred CCCCEEEEEeccEEEEEecccHhHhhhhhccccceeeeec-CCceEEEecCCceEEEeccCCCccceeeecchhhee
Confidence 0000 01112110 00011223444442 555677777778888887777555666677755554
No 117
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.25 E-value=3.6e-10 Score=131.40 Aligned_cols=214 Identities=14% Similarity=0.219 Sum_probs=155.9
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
+++..|-+..+-||..... +-.-++.+|...|.++..... +. +++++|
T Consensus 73 ~l~~g~~D~~i~v~~~~~~-~P~~~LkgH~snVC~ls~~~~---------------~~--~iSgSW-------------- 120 (745)
T KOG0301|consen 73 RLVVGGMDTTIIVFKLSQA-EPLYTLKGHKSNVCSLSIGED---------------GT--LISGSW-------------- 120 (745)
T ss_pred ceEeecccceEEEEecCCC-CchhhhhccccceeeeecCCc---------------Cc--eEeccc--------------
Confidence 4444444555679998773 455678889999999875432 12 345555
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEc--CCEEEEEeCCEEEEEECCCCcEEEEEecCC
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--SRVVAICQAAQVHCFDAATLEIEYAILTNP 264 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~riLAVa~d~~I~IwDl~T~~~l~tL~t~p 264 (921)
++|+++|-. ++++.+++ +...|++|..- ..+|..+.|++|++|.. +++++++.+|.
T Consensus 121 -----------------D~TakvW~~--~~l~~~l~gH~asVWAv~~l~e~~~vTgsaDKtIklWk~--~~~l~tf~gHt 179 (745)
T KOG0301|consen 121 -----------------DSTAKVWRI--GELVYSLQGHTASVWAVASLPENTYVTGSADKTIKLWKG--GTLLKTFSGHT 179 (745)
T ss_pred -----------------ccceEEecc--hhhhcccCCcchheeeeeecCCCcEEeccCcceeeeccC--Cchhhhhccch
Confidence 388999975 56666665 57899999883 35556689999999997 45566776663
Q ss_pred CccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecC
Q 002446 265 IVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLG 344 (921)
Q Consensus 265 ~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lG 344 (921)
++ + |-||.-+
T Consensus 180 D~---------------V----RgL~vl~--------------------------------------------------- 189 (745)
T KOG0301|consen 180 DC---------------V----RGLAVLD--------------------------------------------------- 189 (745)
T ss_pred hh---------------e----eeeEEec---------------------------------------------------
Confidence 31 1 2233210
Q ss_pred CccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCE
Q 002446 345 DLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGIL 424 (921)
Q Consensus 345 d~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtl 424 (921)
..+|+++++||.|+.||+ ++.++..+.+|++-|.+++..+++.+
T Consensus 190 -----------------------------------~~~flScsNDg~Ir~w~~-~ge~l~~~~ghtn~vYsis~~~~~~~ 233 (745)
T KOG0301|consen 190 -----------------------------------DSHFLSCSNDGSIRLWDL-DGEVLLEMHGHTNFVYSISMALSDGL 233 (745)
T ss_pred -----------------------------------CCCeEeecCCceEEEEec-cCceeeeeeccceEEEEEEecCCCCe
Confidence 013556788999999999 78889999999999999999999999
Q ss_pred EEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 425 LVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 425 LATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
++|+++|+| +|||+... +....++. .-.|+++++=++|. |++|++||-|+||...+
T Consensus 234 Ivs~gEDrt-lriW~~~e--------------~~q~I~lP----ttsiWsa~~L~NgD-Ivvg~SDG~VrVfT~~k 289 (745)
T KOG0301|consen 234 IVSTGEDRT-LRIWKKDE--------------CVQVITLP----TTSIWSAKVLLNGD-IVVGGSDGRVRVFTVDK 289 (745)
T ss_pred EEEecCCce-EEEeecCc--------------eEEEEecC----ccceEEEEEeeCCC-EEEeccCceEEEEEecc
Confidence 999999998 89998763 23333431 12499999988887 56888899999998875
No 118
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.25 E-value=3.8e-10 Score=127.03 Aligned_cols=276 Identities=16% Similarity=0.241 Sum_probs=170.3
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEE---e-eeeecCCEEEEEEecCCCCCccccCccccC
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHD---L-VSRYDGPVSFMQMLPRPITSKRSRDKFAEV 162 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~e---l-vS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~ 162 (921)
|.|-|.-+.+.. . .+.|+. |..++++|||+...++-.- + +-.++.-+|.++++|+ .
T Consensus 418 HGEvVcAvtIS~---~---trhVyT-gGkgcVKVWdis~pg~k~PvsqLdcl~rdnyiRSckL~pd-------------g 477 (705)
T KOG0639|consen 418 HGEVVCAVTISN---P---TRHVYT-GGKGCVKVWDISQPGNKSPVSQLDCLNRDNYIRSCKLLPD-------------G 477 (705)
T ss_pred cCcEEEEEEecC---C---cceeEe-cCCCeEEEeeccCCCCCCccccccccCcccceeeeEecCC-------------C
Confidence 445455555433 2 245554 5588999999987543211 1 1135666888888874 2
Q ss_pred CCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCC---CEEEEEEcC--CE
Q 002446 163 RPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRS---PIYSVRCSS--RV 237 (921)
Q Consensus 163 rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s---~V~sV~~S~--ri 237 (921)
|.|| +++. -.+|.||||.+....-..+..+ ..|++++|+ ++
T Consensus 478 rtLi--vGGe--------------------------------astlsiWDLAapTprikaeltssapaCyALa~spDakv 523 (705)
T KOG0639|consen 478 RTLI--VGGE--------------------------------ASTLSIWDLAAPTPRIKAELTSSAPACYALAISPDAKV 523 (705)
T ss_pred ceEE--eccc--------------------------------cceeeeeeccCCCcchhhhcCCcchhhhhhhcCCccce
Confidence 4444 3321 1579999998876554445543 578888884 44
Q ss_pred -EEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccc
Q 002446 238 -VAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFS 316 (921)
Q Consensus 238 -LAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~ 316 (921)
++.+.++.|.|||+.+....+++.+|++-. ..|. .+.+-..+|..|.
T Consensus 524 cFsccsdGnI~vwDLhnq~~VrqfqGhtDGa------------scId-------is~dGtklWTGGl------------- 571 (705)
T KOG0639|consen 524 CFSCCSDGNIAVWDLHNQTLVRQFQGHTDGA------------SCID-------ISKDGTKLWTGGL------------- 571 (705)
T ss_pred eeeeccCCcEEEEEcccceeeecccCCCCCc------------eeEE-------ecCCCceeecCCC-------------
Confidence 344789999999999999899998886411 1122 2222233443331
Q ss_pred cccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEE
Q 002446 317 GFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRD 396 (921)
Q Consensus 317 ~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwD 396 (921)
..+|..|.....+++.. +.++....++ .-||... -++-+...+.|.|..
T Consensus 572 -----DntvRcWDlregrqlqq----------hdF~SQIfSL---------g~cP~~d-------WlavGMens~vevlh 620 (705)
T KOG0639|consen 572 -----DNTVRCWDLREGRQLQQ----------HDFSSQIFSL---------GYCPTGD-------WLAVGMENSNVEVLH 620 (705)
T ss_pred -----ccceeehhhhhhhhhhh----------hhhhhhheec---------ccCCCcc-------ceeeecccCcEEEEe
Confidence 23455555444444432 0111111110 0011000 012234456666665
Q ss_pred CCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 397 IVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 397 l~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
.. +.....+.-|.+-|.+|+|.+-|+++++.+.|. .++.|...-+ ..++.... ...|.++.
T Consensus 621 ~s-kp~kyqlhlheScVLSlKFa~cGkwfvStGkDn-lLnawrtPyG--------------asiFqskE---~SsVlsCD 681 (705)
T KOG0639|consen 621 TS-KPEKYQLHLHESCVLSLKFAYCGKWFVSTGKDN-LLNAWRTPYG--------------ASIFQSKE---SSSVLSCD 681 (705)
T ss_pred cC-CccceeecccccEEEEEEecccCceeeecCchh-hhhhccCccc--------------cceeeccc---cCcceeee
Confidence 43 334567778999999999999999999999995 5899987765 23444432 24599999
Q ss_pred EccCCCEEEEEeCCCcEEEEec
Q 002446 477 FSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi 498 (921)
+|-|.+||++||.|...-||.+
T Consensus 682 IS~ddkyIVTGSGdkkATVYeV 703 (705)
T KOG0639|consen 682 ISFDDKYIVTGSGDKKATVYEV 703 (705)
T ss_pred eccCceEEEecCCCcceEEEEE
Confidence 9999999999999998888875
No 119
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=99.25 E-value=1.3e-09 Score=117.59 Aligned_cols=252 Identities=13% Similarity=0.151 Sum_probs=160.2
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
.+.+|.|.-++|+. .. ..+|+..-++.+++||++.. ..+ +.-.+.+|+-.+++.+.
T Consensus 10 npP~d~IS~v~f~~---~~---~~LLvssWDgslrlYdv~~~-~l~-~~~~~~~plL~c~F~d~---------------- 65 (323)
T KOG1036|consen 10 NPPEDGISSVKFSP---SS---SDLLVSSWDGSLRLYDVPAN-SLK-LKFKHGAPLLDCAFADE---------------- 65 (323)
T ss_pred CCChhceeeEEEcC---cC---CcEEEEeccCcEEEEeccch-hhh-hheecCCceeeeeccCC----------------
Confidence 45699999999995 33 14555555667999999873 222 22235566655555431
Q ss_pred EEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEEEE
Q 002446 165 LLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVAIC 241 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLAVa 241 (921)
.=+++++ .++.||.+|+.+++......+..+|..|..+ +.+|+.+
T Consensus 66 ~~~~~G~--------------------------------~dg~vr~~Dln~~~~~~igth~~~i~ci~~~~~~~~vIsgs 113 (323)
T KOG1036|consen 66 STIVTGG--------------------------------LDGQVRRYDLNTGNEDQIGTHDEGIRCIEYSYEVGCVISGS 113 (323)
T ss_pred ceEEEec--------------------------------cCceEEEEEecCCcceeeccCCCceEEEEeeccCCeEEEcc
Confidence 0011111 2378999999999988888889999999997 4566678
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
.|++|++||.++.....++..- +.+ |+
T Consensus 114 WD~~ik~wD~R~~~~~~~~d~~----------------kkV--------y~----------------------------- 140 (323)
T KOG1036|consen 114 WDKTIKFWDPRNKVVVGTFDQG----------------KKV--------YC----------------------------- 140 (323)
T ss_pred cCccEEEEeccccccccccccC----------------ceE--------EE-----------------------------
Confidence 9999999999873222222110 000 11
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
++.. |+ .++-+..+-.|.+||+.+..
T Consensus 141 --------~~v~----------g~------------------------------------~LvVg~~~r~v~iyDLRn~~ 166 (323)
T KOG1036|consen 141 --------MDVS----------GN------------------------------------RLVVGTSDRKVLIYDLRNLD 166 (323)
T ss_pred --------Eecc----------CC------------------------------------EEEEeecCceEEEEEccccc
Confidence 0000 00 01112345679999999876
Q ss_pred eEEEecc--CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc-----ccEEE
Q 002446 402 VIAQFRA--HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN-----AVIQD 474 (921)
Q Consensus 402 ~l~~~~a--H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~-----a~I~s 474 (921)
...+.+. -+-.+.||++-|++.=.|.+|.||+ |-+=.+++... . .+..-.++.||-... ..|.+
T Consensus 167 ~~~q~reS~lkyqtR~v~~~pn~eGy~~sSieGR-VavE~~d~s~~-~-------~skkyaFkCHr~~~~~~~~~yPVNa 237 (323)
T KOG1036|consen 167 EPFQRRESSLKYQTRCVALVPNGEGYVVSSIEGR-VAVEYFDDSEE-A-------QSKKYAFKCHRLSEKDTEIIYPVNA 237 (323)
T ss_pred chhhhccccceeEEEEEEEecCCCceEEEeecce-EEEEccCCchH-H-------hhhceeEEeeecccCCceEEEEece
Confidence 5444332 2347899999999999999999998 55544443200 0 011222333332111 23899
Q ss_pred EEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 475 ISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 475 IaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
|+|+|--+.||+|+.||-|-+||+.+.+....+.
T Consensus 238 i~Fhp~~~tfaTgGsDG~V~~Wd~~~rKrl~q~~ 271 (323)
T KOG1036|consen 238 IAFHPIHGTFATGGSDGIVNIWDLFNRKRLKQLA 271 (323)
T ss_pred eEeccccceEEecCCCceEEEccCcchhhhhhcc
Confidence 9999999999999999999999998876655553
No 120
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.24 E-value=7.8e-11 Score=139.53 Aligned_cols=111 Identities=16% Similarity=0.302 Sum_probs=91.4
Q ss_pred CcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 381 GHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 381 g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
+.+++..-|.+|++|++....+++.|. |..-|+|++|+| |.+++++||-||+ +|||+|... .+..
T Consensus 381 ~fLLSSSMDKTVRLWh~~~~~CL~~F~-HndfVTcVaFnPvDDryFiSGSLD~K-vRiWsI~d~------------~Vv~ 446 (712)
T KOG0283|consen 381 NFLLSSSMDKTVRLWHPGRKECLKVFS-HNDFVTCVAFNPVDDRYFISGSLDGK-VRLWSISDK------------KVVD 446 (712)
T ss_pred CeeEeccccccEEeecCCCcceeeEEe-cCCeeEEEEecccCCCcEeecccccc-eEEeecCcC------------eeEe
Confidence 345677789999999999999999995 999999999999 8999999999997 999999874 2333
Q ss_pred EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
-+.++ .-|+.+||+|||++.++|+.+|.+++|+.....-...++.|
T Consensus 447 W~Dl~-----~lITAvcy~PdGk~avIGt~~G~C~fY~t~~lk~~~~~~I~ 492 (712)
T KOG0283|consen 447 WNDLR-----DLITAVCYSPDGKGAVIGTFNGYCRFYDTEGLKLVSDFHIR 492 (712)
T ss_pred ehhhh-----hhheeEEeccCCceEEEEEeccEEEEEEccCCeEEEeeeEe
Confidence 23332 23999999999999999999999999998765544444443
No 121
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.24 E-value=6.3e-11 Score=133.20 Aligned_cols=109 Identities=17% Similarity=0.295 Sum_probs=86.3
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC-------------CCCCccCC
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL-------------GTSSACDA 453 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~-------------~~~s~~~~ 453 (921)
..+|.|.|||+.+...+.+|++|+..+.||..++||+.|=|++-|.+ +|-||+.++.. +..+..+|
T Consensus 528 csdGnI~vwDLhnq~~VrqfqGhtDGascIdis~dGtklWTGGlDnt-vRcWDlregrqlqqhdF~SQIfSLg~cP~~dW 606 (705)
T KOG0639|consen 528 CSDGNIAVWDLHNQTLVRQFQGHTDGASCIDISKDGTKLWTGGLDNT-VRCWDLREGRQLQQHDFSSQIFSLGYCPTGDW 606 (705)
T ss_pred ccCCcEEEEEcccceeeecccCCCCCceeEEecCCCceeecCCCccc-eeehhhhhhhhhhhhhhhhhheecccCCCccc
Confidence 45789999999999999999999999999999999999999999987 89999998621 11122222
Q ss_pred C------Ccee-------EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 454 G------TSYV-------HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 454 ~------~~~~-------~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
. +.++ +.|.| +.+...|.++.|++.|+|+++.+.|+-+-.|..
T Consensus 607 lavGMens~vevlh~skp~kyql--hlheScVLSlKFa~cGkwfvStGkDnlLnawrt 662 (705)
T KOG0639|consen 607 LAVGMENSNVEVLHTSKPEKYQL--HLHESCVLSLKFAYCGKWFVSTGKDNLLNAWRT 662 (705)
T ss_pred eeeecccCcEEEEecCCccceee--cccccEEEEEEecccCceeeecCchhhhhhccC
Confidence 1 1111 12333 334456999999999999999999999999987
No 122
>KOG2109 consensus WD40 repeat protein [General function prediction only]
Probab=99.24 E-value=9.9e-12 Score=143.65 Aligned_cols=321 Identities=24% Similarity=0.349 Sum_probs=189.5
Q ss_pred CeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcc
Q 002446 107 RRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLA 185 (921)
Q Consensus 107 ~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~ 185 (921)
.-+++.||=.| .++|-....+.+.+++..+.|+|+...++++- |.++.+
T Consensus 252 Gy~~isglc~g~~~~g~gpglgg~~~~~vGrvg~vsaesV~g~~----------------~vivkd-------------- 301 (788)
T KOG2109|consen 252 GYVLISGLCRGSYQIGTGPGLGGFEEVLVGRVGPVSAESVLGNN----------------LVIVKD-------------- 301 (788)
T ss_pred hHHHHHHHhhcccCCCCCCCCCCcCceeccccccccceeecccc----------------eEEeec--------------
Confidence 35677788666 78999888888988888999999988877531 122221
Q ss_pred cccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCcEEEEEecCCC
Q 002446 186 TACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLEIEYAILTNPI 265 (921)
Q Consensus 186 ~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~ 265 (921)
|-++.+...++.++++..+..++-++-+|+++.-..+.|++++.++..-++.+..
T Consensus 302 ------------------------f~S~a~i~QfkAhkspiSaLcfdqsgsllViasi~g~nVnvfRimet~~t~~~~~- 356 (788)
T KOG2109|consen 302 ------------------------FDSFADIRQFKAHKSPISALCFDQSGSLLVIASITGRNVNVFRIMETVCTVNVSD- 356 (788)
T ss_pred ------------------------ccchhhhhheeeecCcccccccccCceEEEEEeeccceeeeEEeccccccccccc-
Confidence 2233344445555555554444446666666665556666666665544443321
Q ss_pred ccCCCCCCCCCccccceeecCceEEecCCCc---ee---cCCCccCCcccccccccccccCCCcceeehhhhcchhhcce
Q 002446 266 VMGHPSAGGIGIGYGPLAVGPRWLAYSGSPV---VV---SNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAG 339 (921)
Q Consensus 266 ~~g~p~~~g~~i~~~piAlgpRwLAyas~~~---~~---s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasG 339 (921)
.. +..++.++.++||+|..-.. ++ +..|. +..+.+.. .+--|| ++-|-.|
T Consensus 357 --qs-------~~~s~ra~t~aviqdicfs~~s~~r~~gsc~Ge--~P~ls~t~----------~lp~~A---~~Sl~~g 412 (788)
T KOG2109|consen 357 --QS-------LVVSPRANTAAVIQDICFSEVSTIRTAGSCEGE--PPALSLTC----------QLPAYA---DTSLDLG 412 (788)
T ss_pred --cc-------cccchhcchHHHHHHHhhhhhcceEeecccCCC--Cccccccc----------ccchhh---chhhhcc
Confidence 11 23445666666666543111 00 00111 00011000 000011 1111122
Q ss_pred eEecCCccccccc----cccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC-----CC-ceEEEeccC
Q 002446 340 IVNLGDLGYKKLS----QYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV-----SK-NVIAQFRAH 409 (921)
Q Consensus 340 l~~lGd~g~k~ls----~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~-----s~-~~l~~~~aH 409 (921)
+...|......++ .|+....-.++-...+..+..|..|...+..+. ...|.+.+.+.. ++ -.++++-+|
T Consensus 413 l~s~g~~aa~gla~~sag~~a~s~~asSv~s~s~~pd~ks~gv~~gsv~k-~~q~~~~~l~~llv~~psGd~vvqh~vah 491 (788)
T KOG2109|consen 413 LQSSGGLAAEGLATSSAGYTAHSYTASSVFSRSVKPDSKSVGVGSGSVTK-ANQGVITVLNLLLVGEPSGDGVVQHYVAH 491 (788)
T ss_pred ccccCcccceeeeeccccccccccccceeeccccccchhhccceeeeccc-cCccchhhhhheeeecCCCCceeEEEeec
Confidence 2222222111111 122111000000001112333444443332222 233444444432 23 567888899
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
..++..+.|+|+++++.+++..++.+++|.+++...+++ .....|+|+++||.|.++|..++|+-|++|+|....
T Consensus 492 s~~gv~~Ef~~~~~l~lSad~~e~ef~~f~V~Ph~~wss-----laav~hly~l~rG~TsaKv~~~afs~dsrw~A~~t~ 566 (788)
T KOG2109|consen 492 SDPGVYIEFSPDQRLVLSADANENEFNIFLVMPHATWSS-----LAAVQHLYKLNRGSTSAKVVSTAFSEDSRWLAITTN 566 (788)
T ss_pred cCccceeeecccccceecccccccccceEEeecccccHH-----HhhhhhhhhccCCCccceeeeeEeecchhhhhhhhc
Confidence 999999999999999999999999889999998744432 224678999999999999999999999999999999
Q ss_pred CCcEEEEecCCCCCceeecCCCC
Q 002446 490 RGTSHLFAINPLGGSVNFQPTDA 512 (921)
Q Consensus 490 DgTVhVWdi~~~g~~~~l~~H~~ 512 (921)
.+|.|||.+.+|++....++|++
T Consensus 567 ~~TthVfk~hpYgg~aeqrth~~ 589 (788)
T KOG2109|consen 567 HATTHVFKVHPYGGKAEQRTHGD 589 (788)
T ss_pred CCceeeeeeccccccccceecCC
Confidence 99999999999999999999987
No 123
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=99.23 E-value=1.2e-10 Score=130.83 Aligned_cols=115 Identities=25% Similarity=0.408 Sum_probs=91.3
Q ss_pred ccccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
+..+.++|.|.+||+....++.++. +|..|...+||+|. -.+||+.+.|.+ |.+||+... ...
T Consensus 180 L~~asd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsVG~Dkk-i~~yD~~s~--------------~s~ 244 (673)
T KOG4378|consen 180 LSIASDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSVGYDKK-INIYDIRSQ--------------AST 244 (673)
T ss_pred eEeeccCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEecccce-EEEeecccc--------------ccc
Confidence 4456788999999999998887765 99999999999996 568899999976 999999753 111
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCcee-ecCCCCCcc
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVN-FQPTDANFT 515 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~-l~~H~~~~~ 515 (921)
..|- ..+....++|++||.+|++|+.+|.|.-||+.....++. +..|...+.
T Consensus 245 ~~l~---y~~Plstvaf~~~G~~L~aG~s~G~~i~YD~R~~k~Pv~v~sah~~sVt 297 (673)
T KOG4378|consen 245 DRLT---YSHPLSTVAFSECGTYLCAGNSKGELIAYDMRSTKAPVAVRSAHDASVT 297 (673)
T ss_pred ceee---ecCCcceeeecCCceEEEeecCCceEEEEecccCCCCceEeeeccccee
Confidence 1221 123578999999999999999999999999998777764 467765544
No 124
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.23 E-value=3e-10 Score=126.86 Aligned_cols=102 Identities=19% Similarity=0.222 Sum_probs=78.1
Q ss_pred cCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 386 ADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+..+|+|+-+|+++. +++.++++|..+|++|++++. -.+|+|+|.|+. +++|++....+. ....+..++
T Consensus 348 ~tddG~v~~~D~R~~~~~vwt~~AHd~~ISgl~~n~~~p~~l~t~s~d~~-Vklw~~~~~~~~--------~v~~~~~~~ 418 (463)
T KOG0270|consen 348 STDDGTVYYFDIRNPGKPVWTLKAHDDEISGLSVNIQTPGLLSTASTDKV-VKLWKFDVDSPK--------SVKEHSFKL 418 (463)
T ss_pred ecCCceEEeeecCCCCCceeEEEeccCCcceEEecCCCCcceeeccccce-EEEEeecCCCCc--------ccccccccc
Confidence 356899999999975 899999999999999999996 447999999986 999998764111 112222333
Q ss_pred ecccccccEEEEEEccCCC-EEEEEeCCCcEEEEecCCCC
Q 002446 464 QRGLTNAVIQDISFSDDSN-WIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~-~LAsgS~DgTVhVWdi~~~g 502 (921)
- +..|.++.|+-- ++|.|+..+.++|||+.+..
T Consensus 419 ~------rl~c~~~~~~~a~~la~GG~k~~~~vwd~~~~~ 452 (463)
T KOG0270|consen 419 G------RLHCFALDPDVAFTLAFGGEKAVLRVWDIFTNS 452 (463)
T ss_pred c------ceeecccCCCcceEEEecCccceEEEeecccCh
Confidence 2 256788888654 57888889999999998753
No 125
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.22 E-value=9.1e-10 Score=117.85 Aligned_cols=135 Identities=18% Similarity=0.282 Sum_probs=99.5
Q ss_pred CcEEEEEECCCCcEEEEEeCCCCEEEEEEcC-----CEEEEEe-CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcc
Q 002446 205 PTVVHFYSLRSQSYVHMLKFRSPIYSVRCSS-----RVVAICQ-AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIG 278 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~-----riLAVa~-d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~ 278 (921)
+++|++||..|-+..-.++++..||+-++|+ -+||++. +-+|++.|+..+.+-++|.+|-.
T Consensus 123 DhtlKVWDtnTlQ~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~LsGHr~------------- 189 (397)
T KOG4283|consen 123 DHTLKVWDTNTLQEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLSGHRD------------- 189 (397)
T ss_pred cceEEEeecccceeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeeccccC-------------
Confidence 3899999999999999999999999998863 3566644 45999999999999999988732
Q ss_pred ccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccc
Q 002446 279 YGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEF 358 (921)
Q Consensus 279 ~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~ 358 (921)
+.+|+. .+ |. .+ |
T Consensus 190 -~vlaV~-----Ws-------------p~--------------~e------------------------------~---- 202 (397)
T KOG4283|consen 190 -GVLAVE-----WS-------------PS--------------SE------------------------------W---- 202 (397)
T ss_pred -ceEEEE-----ec-------------cC--------------ce------------------------------e----
Confidence 223331 00 00 00 0
Q ss_pred cCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCC------------c---eEEEeccCCCCeEEEEECCCCC
Q 002446 359 LPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSK------------N---VIAQFRAHKSPISALCFDPSGI 423 (921)
Q Consensus 359 ~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~------------~---~l~~~~aH~~pIsaLaFSPdGt 423 (921)
.++++..||.|++||+..- + .+.+-.+|.+.|..+||+.||.
T Consensus 203 -----------------------vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tSd~~ 259 (397)
T KOG4283|consen 203 -----------------------VLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTSDAR 259 (397)
T ss_pred -----------------------EEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecccch
Confidence 1223456778888887532 1 1222347889999999999999
Q ss_pred EEEEEecCCCEEEEEeCCCC
Q 002446 424 LLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 424 lLATaS~DGt~IrIWdi~~g 443 (921)
+|++++.|.+ +++|+...|
T Consensus 260 ~l~~~gtd~r-~r~wn~~~G 278 (397)
T KOG4283|consen 260 YLASCGTDDR-IRVWNMESG 278 (397)
T ss_pred hhhhccCccc-eEEeecccC
Confidence 9999999977 999998876
No 126
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.22 E-value=1.7e-11 Score=142.61 Aligned_cols=214 Identities=16% Similarity=0.260 Sum_probs=153.6
Q ss_pred eEEEEEccC-cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 108 RVLLLGYRS-GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 108 ~vLllG~~~-GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
++++.|... .+-+|.+.... ..--+..|+++|.++.+-+. .-||+ .|+
T Consensus 41 r~~~~Gg~~~k~~L~~i~kp~-~i~S~~~hespIeSl~f~~~--------------E~Lla---ags------------- 89 (825)
T KOG0267|consen 41 RSLVTGGEDEKVNLWAIGKPN-AITSLTGHESPIESLTFDTS--------------ERLLA---AGS------------- 89 (825)
T ss_pred eeeccCCCceeeccccccCCc-hhheeeccCCcceeeecCcc--------------hhhhc---ccc-------------
Confidence 555555544 45588886643 22235579999999987541 11232 111
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcC--CEEEE-EeCCEEEEEECCCCcEEEEEec
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSS--RVVAI-CQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~--riLAV-a~d~~I~IwDl~T~~~l~tL~t 262 (921)
..++|+||||..++.+++|.. ...+.+|.|++ .+.|. +.+..+.+||.+..-|.++...
T Consensus 90 -----------------asgtiK~wDleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~s 152 (825)
T KOG0267|consen 90 -----------------ASGTIKVWDLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYKS 152 (825)
T ss_pred -----------------cCCceeeeehhhhhhhhhhhccccCcceeeeccceEEeccccccccceehhhhccCceeeecC
Confidence 127899999999999999875 67899999984 56666 7899999999998888888765
Q ss_pred CCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEe
Q 002446 263 NPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVN 342 (921)
Q Consensus 263 ~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~ 342 (921)
|+. .+ +.|++. |. |.++
T Consensus 153 ~~~---------------vv----~~l~ls-------------P~--------------Gr~v----------------- 169 (825)
T KOG0267|consen 153 HTR---------------VV----DVLRLS-------------PD--------------GRWV----------------- 169 (825)
T ss_pred Ccc---------------ee----EEEeec-------------CC--------------Ccee-----------------
Confidence 521 11 233333 11 1111
Q ss_pred cCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCC
Q 002446 343 LGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSG 422 (921)
Q Consensus 343 lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdG 422 (921)
++++.|.+|+|||+..|+.+..|+.|...|.++.|.|..
T Consensus 170 -----------------------------------------~~g~ed~tvki~d~~agk~~~ef~~~e~~v~sle~hp~e 208 (825)
T KOG0267|consen 170 -----------------------------------------ASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQSLEFHPLE 208 (825)
T ss_pred -----------------------------------------eccCCcceeeeecccccccccccccccccccccccCchh
Confidence 123446889999999999999999999999999999999
Q ss_pred CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 423 ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 423 tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
-+|+++|.|++ +++||+.+. ..+-.. +.....|++.+|+||++.+++|-..
T Consensus 209 ~Lla~Gs~d~t-v~f~dletf--------------e~I~s~--~~~~~~v~~~~fn~~~~~~~~G~q~ 259 (825)
T KOG0267|consen 209 VLLAPGSSDRT-VRFWDLETF--------------EVISSG--KPETDGVRSLAFNPDGKIVLSGEQI 259 (825)
T ss_pred hhhccCCCCce-eeeecccee--------------EEeecc--CCccCCceeeeecCCceeeecCchh
Confidence 99999999987 899999974 222221 1112359999999999999988654
No 127
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=99.22 E-value=2e-10 Score=132.51 Aligned_cols=121 Identities=17% Similarity=0.245 Sum_probs=80.9
Q ss_pred CCCEEEEEECCCCc------eEEE--eccC---CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCc
Q 002446 388 NVGMVIVRDIVSKN------VIAQ--FRAH---KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTS 456 (921)
Q Consensus 388 ~~G~V~IwDl~s~~------~l~~--~~aH---~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~ 456 (921)
.|+.|+|||+.... +... +.-| .-.+++|..+..|++|.....|++ |..|++.......
T Consensus 238 ~D~~iKVWDLRk~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsCtD~s-Iy~ynm~s~s~sP--------- 307 (720)
T KOG0321|consen 238 ADSTIKVWDLRKNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASCTDNS-IYFYNMRSLSISP--------- 307 (720)
T ss_pred CCcceEEEeecccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEecCCc-EEEEeccccCcCc---------
Confidence 48999999998643 2222 2233 236889999999998777777876 8999988641100
Q ss_pred eeEEEEEecccccccE-EEEEEccCCCEEEEEeCCCcEEEEecCCCCCce-eecCCCCCcccccCCcCCccccCCCC
Q 002446 457 YVHLYRLQRGLTNAVI-QDISFSDDSNWIMISSSRGTSHLFAINPLGGSV-NFQPTDANFTTKHGAMAKSGVRWPPN 531 (921)
Q Consensus 457 ~~~l~~l~RG~t~a~I-~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~-~l~~H~~~~~~~~~~~~~~~~r~~~~ 531 (921)
+..+ -|.-...+ ..=..|||+.+|++|+.|.-..+|.++.....+ .+.+|+-++. +++|.+.
T Consensus 308 ---~~~~-sg~~~~sf~vks~lSpd~~~l~SgSsd~~ayiw~vs~~e~~~~~l~Ght~eVt---------~V~w~pS 371 (720)
T KOG0321|consen 308 ---VAEF-SGKLNSSFYVKSELSPDDCSLLSGSSDEQAYIWVVSSPEAPPALLLGHTREVT---------TVRWLPS 371 (720)
T ss_pred ---hhhc-cCcccceeeeeeecCCCCceEeccCCCcceeeeeecCccCChhhhhCcceEEE---------EEeeccc
Confidence 0000 11111111 123469999999999999999999999877765 4578865554 5666654
No 128
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.21 E-value=9.8e-10 Score=126.07 Aligned_cols=309 Identities=17% Similarity=0.175 Sum_probs=188.9
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCC
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRP 164 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rP 164 (921)
+|++.|..++.|. .| ..|+.|.+.| ++||-+.+ +.+...+. -|+.|+|+++.|.+ ..+
T Consensus 398 GHtg~Vr~iSvdp---~G----~wlasGsdDGtvriWEi~T-gRcvr~~~-~d~~I~~vaw~P~~------------~~~ 456 (733)
T KOG0650|consen 398 GHTGLVRSISVDP---SG----EWLASGSDDGTVRIWEIAT-GRCVRTVQ-FDSEIRSVAWNPLS------------DLC 456 (733)
T ss_pred ccCCeEEEEEecC---Cc----ceeeecCCCCcEEEEEeec-ceEEEEEe-ecceeEEEEecCCC------------Cce
Confidence 7899999999988 55 6889999777 89999998 44444444 57899999998864 357
Q ss_pred EEEEEeCCCCcCCccccCCccccc-CC-CCCCcCCCCCCCCCCcEEEEEECC---CCc--EEEEEeCCCCEEEEEEc--C
Q 002446 165 LLVFCADGSRSCGTKVQDGLATAC-NG-TSANYHDLGNGSSVPTVVHFYSLR---SQS--YVHMLKFRSPIYSVRCS--S 235 (921)
Q Consensus 165 LLAvv~~g~~~g~~~~~Dg~~~~~-~g-~~~~~h~~g~~~~~~~tVrIWDL~---Tg~--~V~tL~f~s~V~sV~~S--~ 235 (921)
+||++-+... . .+.+..+... .+ +.-..+...+....+..|-.|.-. .++ ...+|++..+|..|.+- +
T Consensus 457 vLAvA~~~~~-~--ivnp~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~vtWHrkG 533 (733)
T KOG0650|consen 457 VLAVAVGECV-L--IVNPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQVTWHRKG 533 (733)
T ss_pred eEEEEecCce-E--EeCccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEecCCccceeeeecCC
Confidence 8888776541 0 1111111000 00 000011112333455678899644 222 33567889999999995 6
Q ss_pred CEEEEEeC----CEEEEEECCCCcEE--E-EEecCCCccCCCCCCCCCccccceeecC--ceEEecCCCceecCCCccCC
Q 002446 236 RVVAICQA----AQVHCFDAATLEIE--Y-AILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSPVVVSNDGRVNP 306 (921)
Q Consensus 236 riLAVa~d----~~I~IwDl~T~~~l--~-tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~~~~s~~GrvsP 306 (921)
++||+... ..|.|+++....-. + ...+.+. .+.+.| -+|-.++..
T Consensus 534 DYlatV~~~~~~~~VliHQLSK~~sQ~PF~kskG~vq---------------~v~FHPs~p~lfVaTq~----------- 587 (733)
T KOG0650|consen 534 DYLATVMPDSGNKSVLIHQLSKRKSQSPFRKSKGLVQ---------------RVKFHPSKPYLFVATQR----------- 587 (733)
T ss_pred ceEEEeccCCCcceEEEEecccccccCchhhcCCcee---------------EEEecCCCceEEEEecc-----------
Confidence 89988544 69999998754321 1 1111100 011111 111111110
Q ss_pred cccccccccccccCCCcceeehh---hhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcc
Q 002446 307 QHLMQSRSFSGFASNGSRVAHYA---KESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHF 383 (921)
Q Consensus 307 q~l~~s~~~~~~~s~g~~Va~~A---~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~ 383 (921)
.|..|. .+.-|.|..|.+++.-+.. .|.|. ++
T Consensus 588 -----------------~vRiYdL~kqelvKkL~tg~kwiS~msi----------hp~GD------------------nl 622 (733)
T KOG0650|consen 588 -----------------SVRIYDLSKQELVKKLLTGSKWISSMSI----------HPNGD------------------NL 622 (733)
T ss_pred -----------------ceEEEehhHHHHHHHHhcCCeeeeeeee----------cCCCC------------------eE
Confidence 111111 1334555555555544321 12111 23
Q ss_pred cccCCCCEEEEEECCC-CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 384 PDADNVGMVIVRDIVS-KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s-~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+-+..++.+..+|+.- .++..+++-|...|++|+|.+.=-++|+||.||+ +.||--+-...- -.......+..
T Consensus 623 i~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~ryPLfas~sdDgt-v~Vfhg~VY~Dl-----~qnpliVPlK~ 696 (733)
T KOG0650|consen 623 ILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHKRYPLFASGSDDGT-VIVFHGMVYNDL-----LQNPLIVPLKR 696 (733)
T ss_pred EEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhccccceeeeecCCCc-EEEEeeeeehhh-----hcCCceEeeee
Confidence 3456788999999984 4678899999999999999999999999999998 678854432000 00012344555
Q ss_pred Eecccccc---cEEEEEEccCCCEEEEEeCCCcEEEE
Q 002446 463 LQRGLTNA---VIQDISFSDDSNWIMISSSRGTSHLF 496 (921)
Q Consensus 463 l~RG~t~a---~I~sIaFSPDg~~LAsgS~DgTVhVW 496 (921)
| |||... -|.++.|.|.--||.+++.||||++|
T Consensus 697 L-~gH~~~~~~gVLd~~wHP~qpWLfsAGAd~tirlf 732 (733)
T KOG0650|consen 697 L-RGHEKTNDLGVLDTIWHPRQPWLFSAGADGTIRLF 732 (733)
T ss_pred c-cCceeecccceEeecccCCCceEEecCCCceEEee
Confidence 5 455322 18899999999999999999999999
No 129
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.21 E-value=1.2e-09 Score=122.45 Aligned_cols=177 Identities=18% Similarity=0.199 Sum_probs=129.1
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEc---CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCS---SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S---~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
+.|.|||.+|.+.++.++. +..|.+++|- .++.+.+.|..|++|++..+..+.++-+|+.. .
T Consensus 224 ~~v~Iw~~~t~ehv~~~~ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~~~~~s~vetlyGHqd~--------------v 289 (479)
T KOG0299|consen 224 RHVQIWDCDTLEHVKVFKGHRGAVSSLAFRKGTSELYSASADRSVKVWSIDQLSYVETLYGHQDG--------------V 289 (479)
T ss_pred ceEEEecCcccchhhcccccccceeeeeeecCccceeeeecCCceEEEehhHhHHHHHHhCCccc--------------e
Confidence 7799999999999999875 6799999994 57888899999999999988776666665321 1
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
++++ |.+ + +.
T Consensus 290 ~~Id----aL~----------r------------------eR-------------------------------------- 299 (479)
T KOG0299|consen 290 LGID----ALS----------R------------------ER-------------------------------------- 299 (479)
T ss_pred eeec----hhc----------c------------------cc--------------------------------------
Confidence 1110 000 0 00
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
.+.-++.|.++++|++..- ..-.|++|.+.|-|++|=.+- .++|+|++|. |-+|++.
T Consensus 300 --------------------~vtVGgrDrT~rlwKi~ee-sqlifrg~~~sidcv~~In~~-HfvsGSdnG~-IaLWs~~ 356 (479)
T KOG0299|consen 300 --------------------CVTVGGRDRTVRLWKIPEE-SQLIFRGGEGSIDCVAFINDE-HFVSGSDNGS-IALWSLL 356 (479)
T ss_pred --------------------eEEeccccceeEEEecccc-ceeeeeCCCCCeeeEEEeccc-ceeeccCCce-EEEeeec
Confidence 0011346789999999543 345788999999999998654 6899999997 9999998
Q ss_pred CCCCCCCCccCCCCceeEEEEEeccccc--------ccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 442 PGILGTSSACDAGTSYVHLYRLQRGLTN--------AVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 442 ~g~~~~~s~~~~~~~~~~l~~l~RG~t~--------a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.-.+ ..++.+..|..+ ..|++|+-.|.+..+|+||.+|.|+||.++++
T Consensus 357 KKkp------------lf~~~~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS~~G~vrLW~i~~g 412 (479)
T KOG0299|consen 357 KKKP------------LFTSRLAHGVIPELDPVNGNFWITSLAVIPGSDLLASGSWSGCVRLWKIEDG 412 (479)
T ss_pred ccCc------------eeEeeccccccCCccccccccceeeeEecccCceEEecCCCCceEEEEecCC
Confidence 6411 111121111111 24999999999999999999999999999886
No 130
>KOG4328 consensus WD40 protein [Function unknown]
Probab=99.21 E-value=9.6e-10 Score=123.18 Aligned_cols=99 Identities=22% Similarity=0.328 Sum_probs=77.1
Q ss_pred CCCEEEEEECCCCce-EEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 388 NVGMVIVRDIVSKNV-IAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~-l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
+-|...+||+.++.. ...++-|...|+.|+|+|- -.+|||||.|+| .+|||+..- .+..+ -.++.+.
T Consensus 299 ~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~p~~laT~s~D~T-~kIWD~R~l-~~K~s--------p~lst~~- 367 (498)
T KOG4328|consen 299 NVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVCPWFLATASLDQT-AKIWDLRQL-RGKAS--------PFLSTLP- 367 (498)
T ss_pred cccceEEEEeecCCccchhhhhhhcccceeecCCCCchheeecccCcc-eeeeehhhh-cCCCC--------cceeccc-
Confidence 346788999987654 7788899999999999995 568999999998 899999864 11100 0244442
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+...|.+..|||++--|++.+.|.+|+|||..
T Consensus 368 --HrrsV~sAyFSPs~gtl~TT~~D~~IRv~dss 399 (498)
T KOG4328|consen 368 --HRRSVNSAYFSPSGGTLLTTCQDNEIRVFDSS 399 (498)
T ss_pred --ccceeeeeEEcCCCCceEeeccCCceEEeecc
Confidence 22349999999988889999999999999985
No 131
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.21 E-value=6.3e-11 Score=143.87 Aligned_cols=247 Identities=17% Similarity=0.218 Sum_probs=168.0
Q ss_pred EEEecccCCC--CCCCeEEEEEccCc-EEEEEccCC--CCeEEee---eeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 94 AGFDKLESEA--GATRRVLLLGYRSG-FQVWDVEEA--DNVHDLV---SRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 94 ~~Fd~~~~d~--~~~~~vLllG~~~G-fqVWDv~~~--~~~~elv---S~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
-+|++|.+.. +...-+|+.|.++| +-+||.+.. ++-.+++ +.|.|+|+.+.|-+. .+++
T Consensus 65 ~rF~kL~W~~~g~~~~GlIaGG~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~-------------q~nl 131 (1049)
T KOG0307|consen 65 NRFNKLAWGSYGSHSHGLIAGGLEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPF-------------QGNL 131 (1049)
T ss_pred ccceeeeecccCCCccceeeccccCCceEEecchhhccCcchHHHhhhcccCCceeeeecccc-------------CCce
Confidence 4666665432 11235888888776 899999873 4444444 578999999988642 3467
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEE---eCCCCEEEEEEcC---CEEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHML---KFRSPIYSVRCSS---RVVA 239 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL---~f~s~V~sV~~S~---riLA 239 (921)
||.+++ .+.|.||||..-+.-.+. .+.+.|..|++|+ ++||
T Consensus 132 LASGa~---------------------------------~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILA 178 (1049)
T KOG0307|consen 132 LASGAD---------------------------------DGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILA 178 (1049)
T ss_pred eeccCC---------------------------------CCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhh
Confidence 764432 156999999875543333 3578899999985 6788
Q ss_pred EE-eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccc
Q 002446 240 IC-QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGF 318 (921)
Q Consensus 240 Va-~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~ 318 (921)
.+ ..+++.|||++.-+.+-.+..++.. -.++. |++. |+
T Consensus 179 S~s~sg~~~iWDlr~~~pii~ls~~~~~----------~~~S~-------l~Wh-------------P~----------- 217 (1049)
T KOG0307|consen 179 SGSPSGRAVIWDLRKKKPIIKLSDTPGR----------MHCSV-------LAWH-------------PD----------- 217 (1049)
T ss_pred ccCCCCCceeccccCCCcccccccCCCc----------cceee-------eeeC-------------CC-----------
Confidence 74 4569999999977654444332110 00011 1111 21
Q ss_pred cCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 319 ASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 319 ~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
....+..++ +.+..-.|.+||++
T Consensus 218 -------------------------------------------~aTql~~As--------------~dd~~PviqlWDlR 240 (1049)
T KOG0307|consen 218 -------------------------------------------HATQLLVAS--------------GDDSAPVIQLWDLR 240 (1049)
T ss_pred -------------------------------------------Cceeeeeec--------------CCCCCceeEeeccc
Confidence 111111111 11234579999987
Q ss_pred C-CceEEEeccCCCCeEEEEECCCC-CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 399 S-KNVIAQFRAHKSPISALCFDPSG-ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 399 s-~~~l~~~~aH~~pIsaLaFSPdG-tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
. ..++.+++.|...|.+|.|.+.+ ++|+|++.|++ |-+|+..++ +.++++-++ ...+.++.
T Consensus 241 ~assP~k~~~~H~~GilslsWc~~D~~lllSsgkD~~-ii~wN~~tg--------------Evl~~~p~~--~nW~fdv~ 303 (1049)
T KOG0307|consen 241 FASSPLKILEGHQRGILSLSWCPQDPRLLLSSGKDNR-IICWNPNTG--------------EVLGELPAQ--GNWCFDVQ 303 (1049)
T ss_pred ccCCchhhhcccccceeeeccCCCCchhhhcccCCCC-eeEecCCCc--------------eEeeecCCC--Ccceeeee
Confidence 5 45788899999999999999976 99999999998 889999886 567777542 23489999
Q ss_pred EccCCC-EEEEEeCCCcEEEEecCCC
Q 002446 477 FSDDSN-WIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 477 FSPDg~-~LAsgS~DgTVhVWdi~~~ 501 (921)
|+|-.- .||++|-||+|-||.+...
T Consensus 304 w~pr~P~~~A~asfdgkI~I~sl~~~ 329 (1049)
T KOG0307|consen 304 WCPRNPSVMAAASFDGKISIYSLQGT 329 (1049)
T ss_pred ecCCCcchhhhheeccceeeeeeecC
Confidence 999554 8999999999999999764
No 132
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.20 E-value=1.6e-09 Score=120.81 Aligned_cols=239 Identities=17% Similarity=0.257 Sum_probs=160.0
Q ss_pred CCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 86 SSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 86 ~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
+|.-.|+|+.|.+ +. +.++....+..|+||.+.... ...+..-|+++|.++..-|+. -+
T Consensus 259 Gh~kki~~v~~~~---~~---~~v~~aSad~~i~vws~~~~s-~~~~~~~h~~~V~~ls~h~tg--------------eY 317 (506)
T KOG0289|consen 259 GHTKKITSVKFHK---DL---DTVITASADEIIRVWSVPLSS-EPTSSRPHEEPVTGLSLHPTG--------------EY 317 (506)
T ss_pred CcceEEEEEEecc---ch---hheeecCCcceEEeecccccc-CccccccccccceeeeeccCC--------------cE
Confidence 5666799999988 43 245555556679999998854 445566789999999886641 23
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCC-C--CEEEEEEcC--CEEEE
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFR-S--PIYSVRCSS--RVVAI 240 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~-s--~V~sV~~S~--riLAV 240 (921)
|.-+++ +++..|.|+++|.++...... + .+.+..|-+ -+++.
T Consensus 318 llsAs~---------------------------------d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgt 364 (506)
T KOG0289|consen 318 LLSASN---------------------------------DGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGT 364 (506)
T ss_pred EEEecC---------------------------------CceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEec
Confidence 332221 267889999999988777664 2 467788864 45555
Q ss_pred -EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccccc
Q 002446 241 -CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFA 319 (921)
Q Consensus 241 -a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~ 319 (921)
..++.|+|||+........+ |+ +.+|+ +-|+|+
T Consensus 365 gt~d~~vkiwdlks~~~~a~F---------pg------ht~~v----k~i~Fs--------------------------- 398 (506)
T KOG0289|consen 365 GTPDGVVKIWDLKSQTNVAKF---------PG------HTGPV----KAISFS--------------------------- 398 (506)
T ss_pred cCCCceEEEEEcCCccccccC---------CC------CCCce----eEEEec---------------------------
Confidence 67889999999876533222 21 12333 223443
Q ss_pred CCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCC
Q 002446 320 SNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVS 399 (921)
Q Consensus 320 s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s 399 (921)
|.| |+ ++.+.+++.|++||++.
T Consensus 399 -------------------------ENG------Y~---------------------------Lat~add~~V~lwDLRK 420 (506)
T KOG0289|consen 399 -------------------------ENG------YW---------------------------LATAADDGSVKLWDLRK 420 (506)
T ss_pred -------------------------cCc------eE---------------------------EEEEecCCeEEEEEehh
Confidence 222 22 12345677899999998
Q ss_pred CceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCC-CCCCCccCCCCceeEEEEEecccccccEEEEEE
Q 002446 400 KNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGI-LGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF 477 (921)
Q Consensus 400 ~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~-~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF 477 (921)
.+...+|. .-..+|.+++|+++|++|+.++.| ++||-..... .| .++..+. .+.+..+.+.|
T Consensus 421 l~n~kt~~l~~~~~v~s~~fD~SGt~L~~~g~~---l~Vy~~~k~~k~W-----------~~~~~~~--~~sg~st~v~F 484 (506)
T KOG0289|consen 421 LKNFKTIQLDEKKEVNSLSFDQSGTYLGIAGSD---LQVYICKKKTKSW-----------TEIKELA--DHSGLSTGVRF 484 (506)
T ss_pred hcccceeeccccccceeEEEcCCCCeEEeecce---eEEEEEecccccc-----------eeeehhh--hcccccceeee
Confidence 88777776 334589999999999999999665 5555444210 11 1222221 12234778999
Q ss_pred ccCCCEEEEEeCCCcEEEEec
Q 002446 478 SDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi 498 (921)
-.+.++++++|+|...+|+.+
T Consensus 485 g~~aq~l~s~smd~~l~~~a~ 505 (506)
T KOG0289|consen 485 GEHAQYLASTSMDAILRLYAL 505 (506)
T ss_pred cccceEEeeccchhheEEeec
Confidence 999999999999999999875
No 133
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.19 E-value=2.6e-10 Score=123.00 Aligned_cols=107 Identities=15% Similarity=0.244 Sum_probs=87.6
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
++++..+-+|.|||+. |+.+.++......-...+.||+|++||+++..-. ++||.+--+..|. ..++..++.
T Consensus 202 imsas~dt~i~lw~lk-Gq~L~~idtnq~~n~~aavSP~GRFia~~gFTpD-VkVwE~~f~kdG~------fqev~rvf~ 273 (420)
T KOG2096|consen 202 IMSASLDTKICLWDLK-GQLLQSIDTNQSSNYDAAVSPDGRFIAVSGFTPD-VKVWEPIFTKDGT------FQEVKRVFS 273 (420)
T ss_pred EEEecCCCcEEEEecC-CceeeeeccccccccceeeCCCCcEEEEecCCCC-ceEEEEEeccCcc------hhhhhhhhe
Confidence 4566778899999999 8999999988888888999999999999998765 8999876432221 223455667
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
| .||..+ |..+||||+++.+++.|.||+.+|||++
T Consensus 274 L-kGH~sa-V~~~aFsn~S~r~vtvSkDG~wriwdtd 308 (420)
T KOG2096|consen 274 L-KGHQSA-VLAAAFSNSSTRAVTVSKDGKWRIWDTD 308 (420)
T ss_pred e-ccchhh-eeeeeeCCCcceeEEEecCCcEEEeecc
Confidence 7 476655 9999999999999999999999999986
No 134
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.19 E-value=2.2e-09 Score=128.16 Aligned_cols=236 Identities=15% Similarity=0.208 Sum_probs=159.8
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPL 165 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPL 165 (921)
+.+.|.|+.-+- ..|+.|. ++.+++|.... ++...++-+-.-|++++.+. +.+.+
T Consensus 55 ~g~~v~~ia~~s---------~~f~~~s~~~tv~~y~fps-~~~~~iL~Rftlp~r~~~v~--------------g~g~~ 110 (933)
T KOG1274|consen 55 SGELVSSIACYS---------NHFLTGSEQNTVLRYKFPS-GEEDTILARFTLPIRDLAVS--------------GSGKM 110 (933)
T ss_pred cCceeEEEeecc---------cceEEeeccceEEEeeCCC-CCccceeeeeeccceEEEEe--------------cCCcE
Confidence 456677776554 2455555 55689999987 55666777777777777764 23455
Q ss_pred EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEc--CCEEEE-E
Q 002446 166 LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCS--SRVVAI-C 241 (921)
Q Consensus 166 LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S--~riLAV-a 241 (921)
+|..++ +..|++-++.+....+.++ +..+|..|.++ +.+||| +
T Consensus 111 iaagsd---------------------------------D~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss 157 (933)
T KOG1274|consen 111 IAAGSD---------------------------------DTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSS 157 (933)
T ss_pred EEeecC---------------------------------ceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEe
Confidence 554443 1669999999887777775 57899999996 578998 6
Q ss_pred eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCC
Q 002446 242 QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASN 321 (921)
Q Consensus 242 ~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~ 321 (921)
-+++|+|||+.++.+.+++..-...... +. +.+. .-+|+
T Consensus 158 ~dG~v~iw~~~~~~~~~tl~~v~k~n~~-------~~-s~i~---~~~aW------------------------------ 196 (933)
T KOG1274|consen 158 CDGKVQIWDLQDGILSKTLTGVDKDNEF-------IL-SRIC---TRLAW------------------------------ 196 (933)
T ss_pred cCceEEEEEcccchhhhhcccCCccccc-------cc-ccee---eeeee------------------------------
Confidence 7899999999999988887542110000 00 0000 00011
Q ss_pred CcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCc
Q 002446 322 GSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKN 401 (921)
Q Consensus 322 g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~ 401 (921)
.|+ +++++-...++.|++|+..+..
T Consensus 197 -------------------------------------~Pk------------------~g~la~~~~d~~Vkvy~r~~we 221 (933)
T KOG1274|consen 197 -------------------------------------HPK------------------GGTLAVPPVDNTVKVYSRKGWE 221 (933)
T ss_pred -------------------------------------cCC------------------CCeEEeeccCCeEEEEccCCce
Confidence 111 0123333456889999999988
Q ss_pred eEEEec--cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc
Q 002446 402 VIAQFR--AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD 479 (921)
Q Consensus 402 ~l~~~~--aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP 479 (921)
....++ -|.+.+++++|||.|+|||+++.||. |-|||+.+. .+| +++ ..|.+++|-|
T Consensus 222 ~~f~Lr~~~~ss~~~~~~wsPnG~YiAAs~~~g~-I~vWnv~t~-------------~~~--~~~-----~~Vc~~aw~p 280 (933)
T KOG1274|consen 222 LQFKLRDKLSSSKFSDLQWSPNGKYIAASTLDGQ-ILVWNVDTH-------------ERH--EFK-----RAVCCEAWKP 280 (933)
T ss_pred eheeecccccccceEEEEEcCCCcEEeeeccCCc-EEEEecccc-------------hhc--ccc-----ceeEEEecCC
Confidence 877776 34455999999999999999999997 899999874 112 222 2399999999
Q ss_pred CCCEEEEEeCCCcEEEE
Q 002446 480 DSNWIMISSSRGTSHLF 496 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVW 496 (921)
++.-+-.-..-|+.-+|
T Consensus 281 ~~n~it~~~~~g~~~~~ 297 (933)
T KOG1274|consen 281 NANAITLITALGTLGVS 297 (933)
T ss_pred CCCeeEEEeeccccccC
Confidence 99877666555554444
No 135
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.19 E-value=1.3e-09 Score=117.33 Aligned_cols=266 Identities=13% Similarity=0.173 Sum_probs=166.7
Q ss_pred CCCCCCCCcEEEEEEecccCCCCCCCeEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccc
Q 002446 82 RDDESSHDQVLWAGFDKLESEAGATRRVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFA 160 (921)
Q Consensus 82 ~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~ 160 (921)
++-++|||.|--+.-+. . +.++..+. +..-+||.++. +.|.-.+..|-|.|.+++|.+.
T Consensus 142 re~~GHkDGiW~Vaa~~---t----qpi~gtASADhTA~iWs~Es-g~CL~~Y~GH~GSVNsikfh~s------------ 201 (481)
T KOG0300|consen 142 RELEGHKDGIWHVAADS---T----QPICGTASADHTARIWSLES-GACLATYTGHTGSVNSIKFHNS------------ 201 (481)
T ss_pred hhhcccccceeeehhhc---C----CcceeecccccceeEEeecc-ccceeeecccccceeeEEeccc------------
Confidence 67889999998777766 2 23444443 66789999998 6787778899999999999752
Q ss_pred cCCCEEEEEeCCCCcCCccccCC--cccccCCCCCC--------cCCC-------CCCCCCCcEEEEEECCCCcEEEEEe
Q 002446 161 EVRPLLVFCADGSRSCGTKVQDG--LATACNGTSAN--------YHDL-------GNGSSVPTVVHFYSLRSQSYVHMLK 223 (921)
Q Consensus 161 ~~rPLLAvv~~g~~~g~~~~~Dg--~~~~~~g~~~~--------~h~~-------g~~~~~~~tVrIWDL~Tg~~V~tL~ 223 (921)
+-|++..+++.. +..=.. .......+.+. +|.+ +.......+||+ .+..|+
T Consensus 202 --~~L~lTaSGD~t---aHIW~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRv-------Pl~~lt 269 (481)
T KOG0300|consen 202 --GLLLLTASGDET---AHIWKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRV-------PLMRLT 269 (481)
T ss_pred --cceEEEccCCcc---hHHHHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeee-------eeeeee
Confidence 234333332111 000000 00000000011 1111 111111223332 344444
Q ss_pred C-CCCEEEEEE--c-CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceec
Q 002446 224 F-RSPIYSVRC--S-SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVS 299 (921)
Q Consensus 224 f-~s~V~sV~~--S-~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s 299 (921)
- .+.|.+-.+ . .+++..+-|.+-.+||+.|++.++.|.+|.....- ++ +.
T Consensus 270 gH~~vV~a~dWL~gg~Q~vTaSWDRTAnlwDVEtge~v~~LtGHd~ELtH------------cs------tH-------- 323 (481)
T KOG0300|consen 270 GHRAVVSACDWLAGGQQMVTASWDRTANLWDVETGEVVNILTGHDSELTH------------CS------TH-------- 323 (481)
T ss_pred ccccceEehhhhcCcceeeeeeccccceeeeeccCceeccccCcchhccc------------cc------cC--------
Confidence 3 455555555 2 35666688999999999999998888776332100 00 00
Q ss_pred CCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcc
Q 002446 300 NDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTV 379 (921)
Q Consensus 300 ~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v 379 (921)
|. +.
T Consensus 324 ------pt--------------------------Qr-------------------------------------------- 327 (481)
T KOG0300|consen 324 ------PT--------------------------QR-------------------------------------------- 327 (481)
T ss_pred ------Cc--------------------------ce--------------------------------------------
Confidence 00 00
Q ss_pred cCcccccCCCCEEEEEECCC-CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 380 NGHFPDADNVGMVIVRDIVS-KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 380 ~g~~~s~~~~G~V~IwDl~s-~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
..++...|-+.++||+.. -..+..|++|+..|+++.|..|.+ ++++|+|.| |+|||+..- ..
T Consensus 328 --LVvTsSrDtTFRLWDFReaI~sV~VFQGHtdtVTS~vF~~dd~-vVSgSDDrT-vKvWdLrNM-------------Rs 390 (481)
T KOG0300|consen 328 --LVVTSSRDTTFRLWDFREAIQSVAVFQGHTDTVTSVVFNTDDR-VVSGSDDRT-VKVWDLRNM-------------RS 390 (481)
T ss_pred --EEEEeccCceeEeccchhhcceeeeecccccceeEEEEecCCc-eeecCCCce-EEEeeeccc-------------cC
Confidence 011234466899999974 356789999999999999998876 788999976 999999864 12
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.+.+++ +...++-|+.|.-+..||.--+..-|+|||++-.
T Consensus 391 plATIR---tdS~~NRvavs~g~~iIAiPhDNRqvRlfDlnG~ 430 (481)
T KOG0300|consen 391 PLATIR---TDSPANRVAVSKGHPIIAIPHDNRQVRLFDLNGN 430 (481)
T ss_pred cceeee---cCCccceeEeecCCceEEeccCCceEEEEecCCC
Confidence 244553 2345889999999999999999999999999753
No 136
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.19 E-value=9.2e-11 Score=128.18 Aligned_cols=214 Identities=13% Similarity=0.227 Sum_probs=137.1
Q ss_pred cEEEEEECCCCcEEEEEeC-CCCEEEEEEc-CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccccee
Q 002446 206 TVVHFYSLRSQSYVHMLKF-RSPIYSVRCS-SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLA 283 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S-~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piA 283 (921)
+.|+||||.+.+++.+++. .+.|..|.+. ..++.|+.|++|+.|-+.- ..++++.......+.--. ..+
T Consensus 89 G~VkiWnlsqR~~~~~f~AH~G~V~Gi~v~~~~~~tvgdDKtvK~wk~~~-~p~~tilg~s~~~gIdh~-----~~~--- 159 (433)
T KOG0268|consen 89 GEVKIWNLSQRECIRTFKAHEGLVRGICVTQTSFFTVGDDKTVKQWKIDG-PPLHTILGKSVYLGIDHH-----RKN--- 159 (433)
T ss_pred ceEEEEehhhhhhhheeecccCceeeEEecccceEEecCCcceeeeeccC-Ccceeeeccccccccccc-----ccc---
Confidence 7799999999999999986 5699999996 5788889999999998765 356666543222111000 000
Q ss_pred ecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCc
Q 002446 284 VGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQ 363 (921)
Q Consensus 284 lgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~ 363 (921)
.-.|..+.++.+|..-|..|-. .+ .+|+.+|..
T Consensus 160 ---~~FaTcGe~i~IWD~~R~~Pv~--------------------------sm--------swG~Dti~s---------- 192 (433)
T KOG0268|consen 160 ---SVFATCGEQIDIWDEQRDNPVS--------------------------SM--------SWGADSISS---------- 192 (433)
T ss_pred ---ccccccCceeeecccccCCccc--------------------------ee--------ecCCCceeE----------
Confidence 0112222233333222211110 00 001111000
Q ss_pred CCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 364 NSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 364 ~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
+ ..+|. -...++++..++.|.|||+...+++..+-- +..-..|||+|.+--+++|++|- .+..||+..-
T Consensus 193 --v-kfNpv------ETsILas~~sDrsIvLyD~R~~~Pl~KVi~-~mRTN~IswnPeafnF~~a~ED~-nlY~~DmR~l 261 (433)
T KOG0268|consen 193 --V-KFNPV------ETSILASCASDRSIVLYDLRQASPLKKVIL-TMRTNTICWNPEAFNFVAANEDH-NLYTYDMRNL 261 (433)
T ss_pred --E-ecCCC------cchheeeeccCCceEEEecccCCccceeee-eccccceecCccccceeeccccc-cceehhhhhh
Confidence 0 01111 112344566889999999999887654431 12335689999998999999995 5889988753
Q ss_pred CCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 444 ILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 444 ~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.+-...++||.+| |.++.|||.|+-|++||-|.||+||.++..
T Consensus 262 --------------~~p~~v~~dhvsA-V~dVdfsptG~EfvsgsyDksIRIf~~~~~ 304 (433)
T KOG0268|consen 262 --------------SRPLNVHKDHVSA-VMDVDFSPTGQEFVSGSYDKSIRIFPVNHG 304 (433)
T ss_pred --------------cccchhhccccee-EEEeccCCCcchhccccccceEEEeecCCC
Confidence 1222345788877 999999999999999999999999999875
No 137
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.18 E-value=2.2e-09 Score=115.93 Aligned_cols=223 Identities=14% Similarity=0.259 Sum_probs=138.8
Q ss_pred eEEEEEc-cCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 108 RVLLLGY-RSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 108 ~vLllG~-~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
..++.|. +..+.|||+....+... +..|.|.|.++++.+. . .+..||+... |
T Consensus 54 ~~~aSGssDetI~IYDm~k~~qlg~-ll~HagsitaL~F~~~-~----------S~shLlS~sd-----------D---- 106 (362)
T KOG0294|consen 54 PYVASGSSDETIHIYDMRKRKQLGI-LLSHAGSITALKFYPP-L----------SKSHLLSGSD-----------D---- 106 (362)
T ss_pred eeEeccCCCCcEEEEeccchhhhcc-eeccccceEEEEecCC-c----------chhheeeecC-----------C----
Confidence 5666665 66799999998554444 4458999999999763 1 1124443221 1
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEE--cCCE-EEEEeCCEEEEEECCCCcEEEEEec
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRC--SSRV-VAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~--S~ri-LAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
+.|.+|+...-+++++|+- ...|..|++ ++++ |+|..|..++.||+.+++.-+.+.-
T Consensus 107 -------------------G~i~iw~~~~W~~~~slK~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L 167 (362)
T KOG0294|consen 107 -------------------GHIIIWRVGSWELLKSLKAHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNL 167 (362)
T ss_pred -------------------CcEEEEEcCCeEEeeeecccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeecc
Confidence 5699999999999999985 568999999 4454 5668899999999999987655432
Q ss_pred CCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEe
Q 002446 263 NPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVN 342 (921)
Q Consensus 263 ~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~ 342 (921)
... +- .-+|++-++.-... + + ..|-.|-.+.++-
T Consensus 168 ~~~---------------at--~v~w~~~Gd~F~v~---~---~----------------~~i~i~q~d~A~v------- 201 (362)
T KOG0294|consen 168 KNK---------------AT--LVSWSPQGDHFVVS---G---R----------------NKIDIYQLDNASV------- 201 (362)
T ss_pred CCc---------------ce--eeEEcCCCCEEEEE---e---c----------------cEEEEEecccHhH-------
Confidence 111 00 01233211100000 0 0 0010111111110
Q ss_pred cCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEE--CC
Q 002446 343 LGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCF--DP 420 (921)
Q Consensus 343 lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaF--SP 420 (921)
+..+.. |. -+..+.+.. .+.+..+..++.|.+||..+..++..|.+|...|-.+.| +|
T Consensus 202 -----~~~i~~------~~---r~l~~~~l~------~~~L~vG~d~~~i~~~D~ds~~~~~~~~AH~~RVK~i~~~~~~ 261 (362)
T KOG0294|consen 202 -----FREIEN------PK---RILCATFLD------GSELLVGGDNEWISLKDTDSDTPLTEFLAHENRVKDIASYTNP 261 (362)
T ss_pred -----hhhhhc------cc---cceeeeecC------CceEEEecCCceEEEeccCCCccceeeecchhheeeeEEEecC
Confidence 000000 00 000011110 113345667799999999999999999999999999883 77
Q ss_pred CCCEEEEEecCCCEEEEEeCCCC
Q 002446 421 SGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 421 dGtlLATaS~DGt~IrIWdi~~g 443 (921)
++.+|+|+|.||. |+|||+...
T Consensus 262 ~~~~lvTaSSDG~-I~vWd~~~~ 283 (362)
T KOG0294|consen 262 EHEYLVTASSDGF-IKVWDIDME 283 (362)
T ss_pred CceEEEEeccCce-EEEEEcccc
Confidence 8999999999996 999999874
No 138
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.17 E-value=2.3e-10 Score=125.65 Aligned_cols=118 Identities=17% Similarity=0.287 Sum_probs=88.5
Q ss_pred ccccCCCCEEEEEECCCCc---eEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 383 FPDADNVGMVIVRDIVSKN---VIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~---~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
+.+++..+.|++|...++. -...|.+|+..|-.|++||. ..+||+||.||+ |+|||+..+.. . .
T Consensus 227 LlsGDc~~~I~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~Dgs-IrIWDiRs~~~---------~--~ 294 (440)
T KOG0302|consen 227 LLSGDCVKGIHLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGS-IRIWDIRSGPK---------K--A 294 (440)
T ss_pred cccCccccceEeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCce-EEEEEecCCCc---------c--c
Confidence 4556677889999988764 22456689999999999996 568999999997 99999987511 1 1
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc---eeecCCCCCcc
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS---VNFQPTDANFT 515 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~---~~l~~H~~~~~ 515 (921)
++.+ .. +.+.|+-|+|+.+-.+||+|++|||++||||...... ..|..|..++.
T Consensus 295 ~~~~--kA-h~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pIt 351 (440)
T KOG0302|consen 295 AVST--KA-HNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFKSGQPVATFKYHKAPIT 351 (440)
T ss_pred eeEe--ec-cCCceeeEEccCCcceeeecCCCceEEEEEhhhccCCCcceeEEeccCCee
Confidence 2222 12 3457999999999899999999999999999865332 35566644444
No 139
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.16 E-value=5.3e-09 Score=121.75 Aligned_cols=248 Identities=15% Similarity=0.208 Sum_probs=171.5
Q ss_pred CCCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 82 RDDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 82 ~~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
.+.+++-|.+.|+ . ++ +++.+|.++.+.-||+.+ .+.+......-|++..+++.|.
T Consensus 66 g~~drsIE~L~W~---e---~~----RLFS~g~sg~i~EwDl~~-lk~~~~~d~~gg~IWsiai~p~------------- 121 (691)
T KOG2048|consen 66 GPEDRSIESLAWA---E---GG----RLFSSGLSGSITEWDLHT-LKQKYNIDSNGGAIWSIAINPE------------- 121 (691)
T ss_pred cCCCCceeeEEEc---c---CC----eEEeecCCceEEEEeccc-CceeEEecCCCcceeEEEeCCc-------------
Confidence 4667788888888 2 23 899999999999999998 3444445556688998888653
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC---CCCEEEEEEcC--C
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF---RSPIYSVRCSS--R 236 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f---~s~V~sV~~S~--r 236 (921)
...|++.+++ +.+.+.+...++......| .+.|.+|.+++ .
T Consensus 122 -~~~l~Igcdd---------------------------------Gvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~ 167 (691)
T KOG2048|consen 122 -NTILAIGCDD---------------------------------GVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGT 167 (691)
T ss_pred -cceEEeecCC---------------------------------ceEEEEecCCceEEEEeecccccceEEEEEecCCcc
Confidence 1345555442 3466667666666655555 47899999985 3
Q ss_pred -EEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccc
Q 002446 237 -VVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSF 315 (921)
Q Consensus 237 -iLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~ 315 (921)
+++.+.|+.|+|||+.+++.++.+ +-.. .+. + ...+.++|
T Consensus 168 ~i~~Gs~Dg~Iriwd~~~~~t~~~~-~~~~-d~l---------------~------k~~~~iVW---------------- 208 (691)
T KOG2048|consen 168 KIAGGSIDGVIRIWDVKSGQTLHII-TMQL-DRL---------------S------KREPTIVW---------------- 208 (691)
T ss_pred EEEecccCceEEEEEcCCCceEEEe-eecc-ccc---------------c------cCCceEEE----------------
Confidence 344488999999999998877632 2100 000 0 00001111
Q ss_pred ccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEE
Q 002446 316 SGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVR 395 (921)
Q Consensus 316 ~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~Iw 395 (921)
++..|- .+++++++..|+|++|
T Consensus 209 -----------------------Sv~~Lr-----------------------------------d~tI~sgDS~G~V~FW 230 (691)
T KOG2048|consen 209 -----------------------SVLFLR-----------------------------------DSTIASGDSAGTVTFW 230 (691)
T ss_pred -----------------------EEEEee-----------------------------------cCcEEEecCCceEEEE
Confidence 111110 1134566778999999
Q ss_pred ECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEE
Q 002446 396 DIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDI 475 (921)
Q Consensus 396 Dl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sI 475 (921)
|...++++..++.|..-|.||+-++++.++.+|+.|+++|++...... . .-+...+|.++...|+++
T Consensus 231 d~~~gTLiqS~~~h~adVl~Lav~~~~d~vfsaGvd~~ii~~~~~~~~------------~-~wv~~~~r~~h~hdvrs~ 297 (691)
T KOG2048|consen 231 DSIFGTLIQSHSCHDADVLALAVADNEDRVFSAGVDPKIIQYSLTTNK------------S-EWVINSRRDLHAHDVRSM 297 (691)
T ss_pred cccCcchhhhhhhhhcceeEEEEcCCCCeEEEccCCCceEEEEecCCc------------c-ceeeeccccCCcccceee
Confidence 999999999999999999999999999999999999996665543322 1 123344555566679999
Q ss_pred EEccCCCEEEEEeCCCcEEEEecC
Q 002446 476 SFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 476 aFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+..++ .|.+|+.|.++.+=...
T Consensus 298 av~~~--~l~sgG~d~~l~i~~s~ 319 (691)
T KOG2048|consen 298 AVIEN--ALISGGRDFTLAICSSR 319 (691)
T ss_pred eeecc--eEEecceeeEEEEcccc
Confidence 99988 88999999998875443
No 140
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.16 E-value=8.4e-10 Score=128.43 Aligned_cols=207 Identities=15% Similarity=0.228 Sum_probs=136.9
Q ss_pred cEEEEEECCCCcEEEEEeCCC---CEEE-EEE--c--CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCc
Q 002446 206 TVVHFYSLRSQSYVHMLKFRS---PIYS-VRC--S--SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGI 277 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s---~V~s-V~~--S--~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i 277 (921)
++++||+-+.++++.+..|.. -|.. +++ + .+++....|..|.+|...+.+.+++|.+|..-
T Consensus 35 ~t~~vw~~~~~~~l~~~~~~~~~g~i~~~i~y~e~~~~~l~~g~~D~~i~v~~~~~~~P~~~LkgH~sn----------- 103 (745)
T KOG0301|consen 35 GTVKVWAKKGKQYLETHAFEGPKGFIANSICYAESDKGRLVVGGMDTTIIVFKLSQAEPLYTLKGHKSN----------- 103 (745)
T ss_pred CceeeeeccCcccccceecccCcceeeccceeccccCcceEeecccceEEEEecCCCCchhhhhccccc-----------
Confidence 779999999888887665532 2221 333 2 34555588999999999999999999998542
Q ss_pred cccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCcccccccccccc
Q 002446 278 GYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSE 357 (921)
Q Consensus 278 ~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~ 357 (921)
.++++ ......+++ +|-.+++ .++..|+.++.
T Consensus 104 ---VC~ls-----~~~~~~~iS-------------------gSWD~Ta-------------kvW~~~~l~~~-------- 135 (745)
T KOG0301|consen 104 ---VCSLS-----IGEDGTLIS-------------------GSWDSTA-------------KVWRIGELVYS-------- 135 (745)
T ss_pred ---eeeee-----cCCcCceEe-------------------cccccce-------------EEecchhhhcc--------
Confidence 12211 000000000 0111111 12222333221
Q ss_pred ccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEE
Q 002446 358 FLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINI 437 (921)
Q Consensus 358 ~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrI 437 (921)
++....++..+ ..+....++++..|.+|++|.- ++.+.+|.+|+.-|..|++=|++. +++|+.||. |+.
T Consensus 136 -l~gH~asVWAv------~~l~e~~~vTgsaDKtIklWk~--~~~l~tf~gHtD~VRgL~vl~~~~-flScsNDg~-Ir~ 204 (745)
T KOG0301|consen 136 -LQGHTASVWAV------ASLPENTYVTGSADKTIKLWKG--GTLLKTFSGHTDCVRGLAVLDDSH-FLSCSNDGS-IRL 204 (745)
T ss_pred -cCCcchheeee------eecCCCcEEeccCcceeeeccC--CchhhhhccchhheeeeEEecCCC-eEeecCCce-EEE
Confidence 11111111111 1111235678889999999975 788999999999999999999876 778999996 999
Q ss_pred EeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 438 FKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 438 Wdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
|++.. ..+++++ ||++ -|++|+..+++..+++++.|+|++||+..
T Consensus 205 w~~~g---------------e~l~~~~-ghtn-~vYsis~~~~~~~Ivs~gEDrtlriW~~~ 249 (745)
T KOG0301|consen 205 WDLDG---------------EVLLEMH-GHTN-FVYSISMALSDGLIVSTGEDRTLRIWKKD 249 (745)
T ss_pred EeccC---------------ceeeeee-ccce-EEEEEEecCCCCeEEEecCCceEEEeecC
Confidence 99943 3555653 6654 49999999999999999999999999987
No 141
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.14 E-value=2.9e-08 Score=110.09 Aligned_cols=103 Identities=10% Similarity=0.142 Sum_probs=67.3
Q ss_pred CCEEEEEECCC--C--ceEEEeccCC------CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 389 VGMVIVRDIVS--K--NVIAQFRAHK------SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 389 ~G~V~IwDl~s--~--~~l~~~~aH~------~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
++.|.+||+.. + +.+..+..+. .....+.|+|||++|+++......|.+|++... + ....
T Consensus 196 ~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~~--~--------~~~~ 265 (330)
T PRK11028 196 NSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASLISVFSVSED--G--------SVLS 265 (330)
T ss_pred CCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCeEEEEEEeCC--C--------CeEE
Confidence 57888888863 2 2333443221 123469999999999998765556999999753 0 0111
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeC-CCcEEEEecCCCCCc
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSS-RGTSHLFAINPLGGS 504 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~~g~~ 504 (921)
.+.....|. ....++|+|||++|+++.. +++|.||+++...+.
T Consensus 266 ~~~~~~~~~---~p~~~~~~~dg~~l~va~~~~~~v~v~~~~~~~g~ 309 (330)
T PRK11028 266 FEGHQPTET---QPRGFNIDHSGKYLIAAGQKSHHISVYEIDGETGL 309 (330)
T ss_pred EeEEEeccc---cCCceEECCCCCEEEEEEccCCcEEEEEEcCCCCc
Confidence 122222221 2457899999999998876 899999999754443
No 142
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.12 E-value=7.1e-10 Score=124.52 Aligned_cols=111 Identities=17% Similarity=0.194 Sum_probs=86.0
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
-.|.+++|.+.+|..+..+.+|-.+|+||.|+-||.+|+|||.||. |.+|++..-.... .......++.+. +|
T Consensus 101 i~g~lYlWelssG~LL~v~~aHYQ~ITcL~fs~dgs~iiTgskDg~-V~vW~l~~lv~a~-----~~~~~~p~~~f~-~H 173 (476)
T KOG0646|consen 101 ISGNLYLWELSSGILLNVLSAHYQSITCLKFSDDGSHIITGSKDGA-VLVWLLTDLVSAD-----NDHSVKPLHIFS-DH 173 (476)
T ss_pred ccCcEEEEEeccccHHHHHHhhccceeEEEEeCCCcEEEecCCCcc-EEEEEEEeecccc-----cCCCccceeeec-cC
Confidence 4588999999999999999999999999999999999999999997 8999986531110 111233445553 44
Q ss_pred ccccEEEEEEcc--CCCEEEEEeCCCcEEEEecCCCCCcee
Q 002446 468 TNAVIQDISFSD--DSNWIMISSSRGTSHLFAINPLGGSVN 506 (921)
Q Consensus 468 t~a~I~sIaFSP--Dg~~LAsgS~DgTVhVWdi~~~g~~~~ 506 (921)
+- .|+|+...+ -..+|+++|.|.|+++||++.+.-..+
T Consensus 174 tl-sITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlt 213 (476)
T KOG0646|consen 174 TL-SITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLT 213 (476)
T ss_pred cc-eeEEEEecCCCccceEEEecCCceEEEEEeccceeeEE
Confidence 43 499888765 467899999999999999988643333
No 143
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.12 E-value=5.7e-11 Score=138.33 Aligned_cols=116 Identities=16% Similarity=0.316 Sum_probs=97.7
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
++.+..+|+|++||++..+.+.+|-+|..+|..|.|+|-|.+.|.+|.|+. +++||+... .+.+.
T Consensus 85 laagsasgtiK~wDleeAk~vrtLtgh~~~~~sv~f~P~~~~~a~gStdtd-~~iwD~Rk~--------------Gc~~~ 149 (825)
T KOG0267|consen 85 LAAGSASGTIKVWDLEEAKIVRTLTGHLLNITSVDFHPYGEFFASGSTDTD-LKIWDIRKK--------------GCSHT 149 (825)
T ss_pred hcccccCCceeeeehhhhhhhhhhhccccCcceeeeccceEEecccccccc-ceehhhhcc--------------Cceee
Confidence 445677899999999999999999999999999999999999999999965 999999843 12333
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
+ +| +...|..+.|+|||+|++.+++|.+++|||+..+.-...|.+|...+.
T Consensus 150 ~-~s-~~~vv~~l~lsP~Gr~v~~g~ed~tvki~d~~agk~~~ef~~~e~~v~ 200 (825)
T KOG0267|consen 150 Y-KS-HTRVVDVLRLSPDGRWVASGGEDNTVKIWDLTAGKLSKEFKSHEGKVQ 200 (825)
T ss_pred e-cC-CcceeEEEeecCCCceeeccCCcceeeeeccccccccccccccccccc
Confidence 3 45 445599999999999999999999999999987766677887766544
No 144
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.11 E-value=2.1e-07 Score=99.10 Aligned_cols=254 Identities=18% Similarity=0.311 Sum_probs=164.5
Q ss_pred CCCCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCC-CeEEeeeeecCCEEEEEEecCCCCCccccCccccCC
Q 002446 85 ESSHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEAD-NVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVR 163 (921)
Q Consensus 85 ~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~-~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~r 163 (921)
..+.+.|.-+.|+. .+ ..++..+.++.+.+|+..... ....+...+...+..+... .+.. .
T Consensus 62 ~~~~~~i~~~~~~~---~~---~~~~~~~~d~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~-----------~ 123 (466)
T COG2319 62 RGHEDSITSIAFSP---DG---ELLLSGSSDGTIKLWDLDNGEKLIKSLEGLHDSSVSKLALS-SPDG-----------N 123 (466)
T ss_pred eeccceEEEEEECC---CC---cEEEEecCCCcEEEEEcCCCceeEEEEeccCCCceeeEEEE-CCCc-----------c
Confidence 46778888888887 44 244555568889999998743 2222222222244444432 2110 0
Q ss_pred CEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCC-CcEEEEEeC-CCCEEEEEEc--CCEEE
Q 002446 164 PLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRS-QSYVHMLKF-RSPIYSVRCS--SRVVA 239 (921)
Q Consensus 164 PLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~T-g~~V~tL~f-~s~V~sV~~S--~riLA 239 (921)
.+++.+.. .++++++||..+ ...+..+.. ...|..+.++ .+.++
T Consensus 124 ~~~~~~~~--------------------------------~d~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~ 171 (466)
T COG2319 124 SILLASSS--------------------------------LDGTVKLWDLSTPGKLIRTLEGHSESVTSLAFSPDGKLLA 171 (466)
T ss_pred eEEeccCC--------------------------------CCccEEEEEecCCCeEEEEEecCcccEEEEEECCCCCEEE
Confidence 12221111 126799999998 677776665 5788889996 35566
Q ss_pred EEe--CCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccc
Q 002446 240 ICQ--AAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSG 317 (921)
Q Consensus 240 Va~--d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~ 317 (921)
++. ++.+++||+.+...+.++..+.. .+ ..+++.. .
T Consensus 172 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~---------------~v----~~~~~~~-------------~---------- 209 (466)
T COG2319 172 SGSSLDGTIKLWDLRTGKPLSTLAGHTD---------------PV----SSLAFSP-------------D---------- 209 (466)
T ss_pred ecCCCCCceEEEEcCCCceEEeeccCCC---------------ce----EEEEEcC-------------C----------
Confidence 643 89999999998766666654311 01 1122220 0
Q ss_pred ccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEEC
Q 002446 318 FASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDI 397 (921)
Q Consensus 318 ~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl 397 (921)
+.. .+++...++.|++||.
T Consensus 210 ----~~~---------------------------------------------------------~~~~~~~d~~i~~wd~ 228 (466)
T COG2319 210 ----GGL---------------------------------------------------------LIASGSSDGTIRLWDL 228 (466)
T ss_pred ----cce---------------------------------------------------------EEEEecCCCcEEEEEC
Confidence 000 0011245688999999
Q ss_pred CCCceEE-EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEE
Q 002446 398 VSKNVIA-QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDIS 476 (921)
Q Consensus 398 ~s~~~l~-~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIa 476 (921)
..+..+. .+..|...+ ...|+|++.++++++.|+. +++|++... ...+..+ .++ ...|.++.
T Consensus 229 ~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~d~~-~~~~~~~~~-------------~~~~~~~-~~~-~~~v~~~~ 291 (466)
T COG2319 229 STGKLLRSTLSGHSDSV-VSSFSPDGSLLASGSSDGT-IRLWDLRSS-------------SSLLRTL-SGH-SSSVLSVA 291 (466)
T ss_pred CCCcEEeeecCCCCcce-eEeECCCCCEEEEecCCCc-EEEeeecCC-------------CcEEEEE-ecC-CccEEEEE
Confidence 9888888 799999886 4489999999999999987 999999865 1122333 333 34599999
Q ss_pred EccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 477 FSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 477 FSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
|+|++..+++++.|+++++|++..........
T Consensus 292 ~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~ 323 (466)
T COG2319 292 FSPDGKLLASGSSDGTVRLWDLETGKLLSSLT 323 (466)
T ss_pred ECCCCCEEEEeeCCCcEEEEEcCCCceEEEee
Confidence 99999999999999999999887765444443
No 145
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.11 E-value=3.1e-08 Score=102.97 Aligned_cols=100 Identities=20% Similarity=0.342 Sum_probs=83.7
Q ss_pred ccccCCCCEEEEEECCCCceEEEec--cC-----CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR--AH-----KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~--aH-----~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
++++..+.+|+.||+.-..++.++. -| .+.|++++.+|.|++||++-.|.. ..+||+.-+
T Consensus 197 ~~sgsqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dss-c~lydirg~------------ 263 (350)
T KOG0641|consen 197 FASGSQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSS-CMLYDIRGG------------ 263 (350)
T ss_pred EEccCCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCc-eEEEEeeCC------------
Confidence 3456778899999999888887775 22 368999999999999999999975 799999875
Q ss_pred ceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 456 SYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+.+.+++. +.+.|.|+-|||-..|+.++|-|..|++=|+.
T Consensus 264 --r~iq~f~p--hsadir~vrfsp~a~yllt~syd~~ikltdlq 303 (350)
T KOG0641|consen 264 --RMIQRFHP--HSADIRCVRFSPGAHYLLTCSYDMKIKLTDLQ 303 (350)
T ss_pred --ceeeeeCC--CccceeEEEeCCCceEEEEecccceEEEeecc
Confidence 45555542 45779999999999999999999999999885
No 146
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.10 E-value=9.7e-11 Score=131.13 Aligned_cols=209 Identities=16% Similarity=0.206 Sum_probs=136.7
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEE--cCCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccccee
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRC--SSRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLA 283 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~--S~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piA 283 (921)
+.|--+|..|+++..+|.....|++|.| +.+++||++.+.++||| ..+..+++|..+..+.- +.+=|.-
T Consensus 151 GHlAa~Dw~t~~L~~Ei~v~Etv~Dv~~LHneq~~AVAQK~y~yvYD-~~GtElHClk~~~~v~r--------LeFLPyH 221 (545)
T KOG1272|consen 151 GHLAAFDWVTKKLHFEINVMETVRDVTFLHNEQFFAVAQKKYVYVYD-NNGTELHCLKRHIRVAR--------LEFLPYH 221 (545)
T ss_pred cceeeeecccceeeeeeehhhhhhhhhhhcchHHHHhhhhceEEEec-CCCcEEeehhhcCchhh--------hcccchh
Confidence 5688899999999999999999999999 68999999999999999 45666888876532110 1111100
Q ss_pred ecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCc
Q 002446 284 VGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQ 363 (921)
Q Consensus 284 lgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~ 363 (921)
=.||.+ +..|.+.-+. -|.|++|+...+.. |+..
T Consensus 222 ---fLL~~~------~~~G~L~Y~D----------VS~GklVa~~~t~~-----------G~~~---------------- 255 (545)
T KOG1272|consen 222 ---FLLVAA------SEAGFLKYQD----------VSTGKLVASIRTGA-----------GRTD---------------- 255 (545)
T ss_pred ---heeeec------ccCCceEEEe----------echhhhhHHHHccC-----------Cccc----------------
Confidence 011111 1122221111 12344443322211 1110
Q ss_pred CCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 364 NSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 364 ~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
.-.-+| .|+++ -.+...|+|.+|...+.+++..+..|.++|++|+++|+|+|+||++.|.. ++|||+...
T Consensus 256 --vm~qNP---~NaVi----h~GhsnGtVSlWSP~skePLvKiLcH~g~V~siAv~~~G~YMaTtG~Dr~-~kIWDlR~~ 325 (545)
T KOG1272|consen 256 --VMKQNP---YNAVI----HLGHSNGTVSLWSPNSKEPLVKILCHRGPVSSIAVDRGGRYMATTGLDRK-VKIWDLRNF 325 (545)
T ss_pred --hhhcCC---ccceE----EEcCCCceEEecCCCCcchHHHHHhcCCCcceEEECCCCcEEeecccccc-eeEeeeccc
Confidence 000011 12222 23566799999999999999999999999999999999999999999965 999999874
Q ss_pred CCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 444 ILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 444 ~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
.++.+++. ......++||.-|- ||.+ ...-|+||.=
T Consensus 326 --------------~ql~t~~t---p~~a~~ls~Sqkgl-LA~~-~G~~v~iw~d 361 (545)
T KOG1272|consen 326 --------------YQLHTYRT---PHPASNLSLSQKGL-LALS-YGDHVQIWKD 361 (545)
T ss_pred --------------cccceeec---CCCccccccccccc-eeee-cCCeeeeehh
Confidence 34455432 22367899997774 3333 3346899963
No 147
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.09 E-value=1.7e-09 Score=116.50 Aligned_cols=110 Identities=15% Similarity=0.250 Sum_probs=89.4
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
.+++.-|.+..+||++++.++..+.+|.+..+.++-.|.-++++|+|.|-| +|+||..+. ...+..
T Consensus 287 ~vTaSWDRTAnlwDVEtge~v~~LtGHd~ELtHcstHptQrLVvTsSrDtT-FRLWDFRea-------------I~sV~V 352 (481)
T KOG0300|consen 287 MVTASWDRTANLWDVETGEVVNILTGHDSELTHCSTHPTQRLVVTSSRDTT-FRLWDFREA-------------IQSVAV 352 (481)
T ss_pred eeeeeccccceeeeeccCceeccccCcchhccccccCCcceEEEEeccCce-eEeccchhh-------------cceeee
Confidence 345677889999999999999999999999999999999999999999965 999999864 222333
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc-eeecC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS-VNFQP 509 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~-~~l~~ 509 (921)
..||+. .|+++.|.-|.+ +++||+|.||+|||+..-..+ .+++.
T Consensus 353 -FQGHtd-tVTS~vF~~dd~-vVSgSDDrTvKvWdLrNMRsplATIRt 397 (481)
T KOG0300|consen 353 -FQGHTD-TVTSVVFNTDDR-VVSGSDDRTVKVWDLRNMRSPLATIRT 397 (481)
T ss_pred -eccccc-ceeEEEEecCCc-eeecCCCceEEEeeeccccCcceeeec
Confidence 357765 499999998865 779999999999999764332 34443
No 148
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=99.08 E-value=1e-08 Score=119.33 Aligned_cols=191 Identities=19% Similarity=0.279 Sum_probs=130.9
Q ss_pred cEEEEEECCCCcEE-EEEeC--CCCEEEEEEc--CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccc
Q 002446 206 TVVHFYSLRSQSYV-HMLKF--RSPIYSVRCS--SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYG 280 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V-~tL~f--~s~V~sV~~S--~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~ 280 (921)
+.|.||+++.+=+. ..|.. .+.|.++++. .|++.+.+++.|.-||+.+++.++.+..... ...
T Consensus 47 g~IEiwN~~~~w~~~~vi~g~~drsIE~L~W~e~~RLFS~g~sg~i~EwDl~~lk~~~~~d~~gg------------~IW 114 (691)
T KOG2048|consen 47 GNIEIWNLSNNWFLEPVIHGPEDRSIESLAWAEGGRLFSSGLSGSITEWDLHTLKQKYNIDSNGG------------AIW 114 (691)
T ss_pred CcEEEEccCCCceeeEEEecCCCCceeeEEEccCCeEEeecCCceEEEEecccCceeEEecCCCc------------cee
Confidence 67999999987433 33443 4689999996 5888889999999999999998877653210 111
Q ss_pred ceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccC
Q 002446 281 PLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLP 360 (921)
Q Consensus 281 piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p 360 (921)
.||+ . |. + ..
T Consensus 115 siai-------~-------------p~--------------~-----------~~------------------------- 124 (691)
T KOG2048|consen 115 SIAI-------N-------------PE--------------N-----------TI------------------------- 124 (691)
T ss_pred EEEe-------C-------------Cc--------------c-----------ce-------------------------
Confidence 2221 1 11 0 00
Q ss_pred CCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceE--EEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEE
Q 002446 361 DSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVI--AQFRAHKSPISALCFDPSGILLVTASVQGHNINIF 438 (921)
Q Consensus 361 ~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l--~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIW 438 (921)
++-++.+|.+..++...+... ..|...++.|.+|+|+|+|+.||+|+.||. |++|
T Consensus 125 ----------------------l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~~~~~i~~Gs~Dg~-Iriw 181 (691)
T KOG2048|consen 125 ----------------------LAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNPTGTKIAGGSIDGV-IRIW 181 (691)
T ss_pred ----------------------EEeecCCceEEEEecCCceEEEEeecccccceEEEEEecCCccEEEecccCce-EEEE
Confidence 011245565555666555443 234456789999999999999999999995 9999
Q ss_pred eCCCCCCCCCCccCCCCceeE-----EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCC
Q 002446 439 KIIPGILGTSSACDAGTSYVH-----LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDAN 513 (921)
Q Consensus 439 di~~g~~~~~s~~~~~~~~~~-----l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~ 513 (921)
|+..+ ...+ +-++.++ ...-|+++.|=.|+. ||+|.+.|||.+||-..+.....+..|..+
T Consensus 182 d~~~~------------~t~~~~~~~~d~l~k~-~~~iVWSv~~Lrd~t-I~sgDS~G~V~FWd~~~gTLiqS~~~h~ad 247 (691)
T KOG2048|consen 182 DVKSG------------QTLHIITMQLDRLSKR-EPTIVWSVLFLRDST-IASGDSAGTVTFWDSIFGTLIQSHSCHDAD 247 (691)
T ss_pred EcCCC------------ceEEEeeecccccccC-CceEEEEEEEeecCc-EEEecCCceEEEEcccCcchhhhhhhhhcc
Confidence 99986 1122 2233332 223489999987765 789999999999999887666677777665
Q ss_pred cc
Q 002446 514 FT 515 (921)
Q Consensus 514 ~~ 515 (921)
+.
T Consensus 248 Vl 249 (691)
T KOG2048|consen 248 VL 249 (691)
T ss_pred ee
Confidence 44
No 149
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=99.07 E-value=1e-07 Score=105.77 Aligned_cols=112 Identities=8% Similarity=0.134 Sum_probs=72.3
Q ss_pred CCCEEEEEECCCCceEE-------EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 388 NVGMVIVRDIVSKNVIA-------QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~-------~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
.++.|.|||+.+...+. .+... .....++|+|||++|+++......|.+|++... . +....+
T Consensus 146 ~~~~v~v~d~~~~g~l~~~~~~~~~~~~g-~~p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~-~---------~~~~~~ 214 (330)
T PRK11028 146 KEDRIRLFTLSDDGHLVAQEPAEVTTVEG-AGPRHMVFHPNQQYAYCVNELNSSVDVWQLKDP-H---------GEIECV 214 (330)
T ss_pred CCCEEEEEEECCCCcccccCCCceecCCC-CCCceEEECCCCCEEEEEecCCCEEEEEEEeCC-C---------CCEEEE
Confidence 35789999997643221 12222 335679999999999988874455999999752 0 012223
Q ss_pred EEEecc---c-ccccEEEEEEccCCCEEEEEeC-CCcEEEEecCCCCCceeecCC
Q 002446 461 YRLQRG---L-TNAVIQDISFSDDSNWIMISSS-RGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 461 ~~l~RG---~-t~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~~g~~~~l~~H 510 (921)
.++... . .......|.|+||+++|+++.. +++|.||++++.++...+..|
T Consensus 215 ~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~~~~~~~~~~~ 269 (330)
T PRK11028 215 QTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASLISVFSVSEDGSVLSFEGH 269 (330)
T ss_pred EEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCeEEEEEEeCCCCeEEEeEE
Confidence 333210 0 0011346999999999999854 789999999887666555554
No 150
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.05 E-value=8.4e-09 Score=112.04 Aligned_cols=254 Identities=16% Similarity=0.250 Sum_probs=152.5
Q ss_pred CeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCccc
Q 002446 107 RRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLAT 186 (921)
Q Consensus 107 ~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~ 186 (921)
+-+.+.||.+-++|.|+.. +.+..-+-.|.+.|..+++.|. +|-|.++... |
T Consensus 106 p~la~~G~~GvIrVid~~~-~~~~~~~~ghG~sINeik~~p~--------------~~qlvls~Sk---------D---- 157 (385)
T KOG1034|consen 106 PFLAAGGYLGVIRVIDVVS-GQCSKNYRGHGGSINEIKFHPD--------------RPQLVLSASK---------D---- 157 (385)
T ss_pred eeEEeecceeEEEEEecch-hhhccceeccCccchhhhcCCC--------------CCcEEEEecC---------C----
Confidence 3455556566689999988 5566666678899999988773 4555555421 2
Q ss_pred ccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe----CCCCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEE
Q 002446 187 ACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK----FRSPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYA 259 (921)
Q Consensus 187 ~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~----f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~t 259 (921)
.+||+|+++++.|+..+. ++..|.+|.|+ +++|+. ..|.+|.+|++...+-...
T Consensus 158 -------------------~svRlwnI~~~~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~l~~~~f~~~ 218 (385)
T KOG1034|consen 158 -------------------HSVRLWNIQTDVCVAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWRLNVKEFKNK 218 (385)
T ss_pred -------------------ceEEEEeccCCeEEEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEecChhHHhhh
Confidence 779999999999999985 47899999997 466776 7889999999996543323
Q ss_pred EecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcce
Q 002446 260 ILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAG 339 (921)
Q Consensus 260 L~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasG 339 (921)
|+-. ... .+. ....|+ +.. .-.||...+ ++.=+..+..
T Consensus 219 lE~s-~~~-~~~-----~t~~pf---------pt~-----------------~~~fp~fst---------~diHrnyVDC 256 (385)
T KOG1034|consen 219 LELS-ITY-SPN-----KTTRPF---------PTP-----------------KTHFPDFST---------TDIHRNYVDC 256 (385)
T ss_pred hhhh-ccc-CCC-----CccCcC---------Ccc-----------------ccccccccc---------cccccchHHH
Confidence 3211 000 000 000111 100 000111000 0000111123
Q ss_pred eEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC-C-------------CceEEE
Q 002446 340 IVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV-S-------------KNVIAQ 405 (921)
Q Consensus 340 l~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~-s-------------~~~l~~ 405 (921)
++++|+... +...++.|..|-.. - -..+.+
T Consensus 257 vrw~gd~il------------------------------------SkscenaI~~w~pgkl~e~~~~vkp~es~~Ti~~~ 300 (385)
T KOG1034|consen 257 VRWFGDFIL------------------------------------SKSCENAIVCWKPGKLEESIHNVKPPESATTILGE 300 (385)
T ss_pred HHHHhhhee------------------------------------ecccCceEEEEecchhhhhhhccCCCccceeeeeE
Confidence 344444321 12223345555441 0 123445
Q ss_pred eccCCCCeEEE--EECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCE
Q 002446 406 FRAHKSPISAL--CFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNW 483 (921)
Q Consensus 406 ~~aH~~pIsaL--aFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~ 483 (921)
|.-....|.-| +|+|-+++||.+...|+ +.+||+....+.. ...+.+. .+ .+.|+..+||.||.+
T Consensus 301 ~~~~~c~iWfirf~~d~~~~~la~gnq~g~-v~vwdL~~~ep~~--------~ttl~~s-~~---~~tVRQ~sfS~dgs~ 367 (385)
T KOG1034|consen 301 FDYPMCDIWFIRFAFDPWQKMLALGNQSGK-VYVWDLDNNEPPK--------CTTLTHS-KS---GSTVRQTSFSRDGSI 367 (385)
T ss_pred eccCccceEEEEEeecHHHHHHhhccCCCc-EEEEECCCCCCcc--------CceEEec-cc---cceeeeeeecccCcE
Confidence 55555566665 45667999999999997 8999998752111 1112111 22 345999999999999
Q ss_pred EEEEeCCCcEEEEec
Q 002446 484 IMISSSRGTSHLFAI 498 (921)
Q Consensus 484 LAsgS~DgTVhVWdi 498 (921)
|+...+|+||--||.
T Consensus 368 lv~vcdd~~Vwrwdr 382 (385)
T KOG1034|consen 368 LVLVCDDGTVWRWDR 382 (385)
T ss_pred EEEEeCCCcEEEEEe
Confidence 999999999988885
No 151
>PRK01742 tolB translocation protein TolB; Provisional
Probab=99.04 E-value=2.4e-08 Score=115.52 Aligned_cols=79 Identities=16% Similarity=0.151 Sum_probs=55.9
Q ss_pred EEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcE
Q 002446 414 SALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTS 493 (921)
Q Consensus 414 saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTV 493 (921)
.+++|+|||++|+.++.++ +.+||+.++ ... .+..+. ...+++|||||++|+.++.++.+
T Consensus 336 ~~~~~SpDG~~ia~~~~~~--i~~~Dl~~g------------~~~---~lt~~~---~~~~~~~sPdG~~i~~~s~~g~~ 395 (429)
T PRK01742 336 YSAQISADGKTLVMINGDN--VVKQDLTSG------------STE---VLSSTF---LDESPSISPNGIMIIYSSTQGLG 395 (429)
T ss_pred CCccCCCCCCEEEEEcCCC--EEEEECCCC------------CeE---EecCCC---CCCCceECCCCCEEEEEEcCCCc
Confidence 4578999999999988764 556998775 111 121121 23568899999999999999999
Q ss_pred EEEecCC--CCCceeecCCCC
Q 002446 494 HLFAINP--LGGSVNFQPTDA 512 (921)
Q Consensus 494 hVWdi~~--~g~~~~l~~H~~ 512 (921)
.+|.+.. +.....+.+|.+
T Consensus 396 ~~l~~~~~~G~~~~~l~~~~g 416 (429)
T PRK01742 396 KVLQLVSADGRFKARLPGSDG 416 (429)
T ss_pred eEEEEEECCCCceEEccCCCC
Confidence 9998743 334456666644
No 152
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=99.04 E-value=1.2e-08 Score=114.56 Aligned_cols=98 Identities=16% Similarity=0.320 Sum_probs=77.9
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
.+..|.|.|....++..+.+|+- .+.|+.++|+.||+.|..++.+|. |.+||+... .+.+.+.-.-
T Consensus 321 ~G~~G~I~lLhakT~eli~s~Ki-eG~v~~~~fsSdsk~l~~~~~~Ge-V~v~nl~~~------------~~~~rf~D~G 386 (514)
T KOG2055|consen 321 AGNNGHIHLLHAKTKELITSFKI-EGVVSDFTFSSDSKELLASGGTGE-VYVWNLRQN------------SCLHRFVDDG 386 (514)
T ss_pred cccCceEEeehhhhhhhhheeee-ccEEeeEEEecCCcEEEEEcCCce-EEEEecCCc------------ceEEEEeecC
Confidence 34568889988888888888874 367999999999999999999996 899999875 2333333322
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
+. . =+++|.|+++.|||+||..|-|-|||.+.
T Consensus 387 ~v-~--gts~~~S~ng~ylA~GS~~GiVNIYd~~s 418 (514)
T KOG2055|consen 387 SV-H--GTSLCISLNGSYLATGSDSGIVNIYDGNS 418 (514)
T ss_pred cc-c--eeeeeecCCCceEEeccCcceEEEeccch
Confidence 22 1 36889999999999999999999999765
No 153
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.03 E-value=1.2e-09 Score=120.22 Aligned_cols=106 Identities=18% Similarity=0.289 Sum_probs=85.2
Q ss_pred CcccccCCCCEEEEEECCCC---ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 381 GHFPDADNVGMVIVRDIVSK---NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 381 g~~~s~~~~G~V~IwDl~s~---~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
+.|+++..||.|+|||++++ .++ ..++|.+-|+.|.|+..-.+||++++||+ ++|||+.....+
T Consensus 271 ~vfaScS~DgsIrIWDiRs~~~~~~~-~~kAh~sDVNVISWnr~~~lLasG~DdGt-~~iwDLR~~~~~----------- 337 (440)
T KOG0302|consen 271 GVFASCSCDGSIRIWDIRSGPKKAAV-STKAHNSDVNVISWNRREPLLASGGDDGT-LSIWDLRQFKSG----------- 337 (440)
T ss_pred ceEEeeecCceEEEEEecCCCcccee-EeeccCCceeeEEccCCcceeeecCCCce-EEEEEhhhccCC-----------
Confidence 45678889999999999987 343 34899999999999999889999999998 899999975211
Q ss_pred eEEEEEecccccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCC
Q 002446 458 VHLYRLQRGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~ 501 (921)
..+..+.+ +.+.|++|.|+| +...||+++.|..|.|||++-.
T Consensus 338 ~pVA~fk~--Hk~pItsieW~p~e~s~iaasg~D~QitiWDlsvE 380 (440)
T KOG0302|consen 338 QPVATFKY--HKAPITSIEWHPHEDSVIAASGEDNQITIWDLSVE 380 (440)
T ss_pred CcceeEEe--ccCCeeEEEeccccCceEEeccCCCcEEEEEeecc
Confidence 12233332 335699999998 5778899999999999999753
No 154
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=99.02 E-value=3.2e-09 Score=121.97 Aligned_cols=94 Identities=17% Similarity=0.237 Sum_probs=77.1
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
...|+|||+....++..+..-..-|+.|+.+|.|.-|+.++.|++ +..||+.-. ...|+.-|-|.
T Consensus 586 q~~vRiYdL~kqelvKkL~tg~kwiS~msihp~GDnli~gs~d~k-~~WfDldls--------------skPyk~lr~H~ 650 (733)
T KOG0650|consen 586 QRSVRIYDLSKQELVKKLLTGSKWISSMSIHPNGDNLILGSYDKK-MCWFDLDLS--------------SKPYKTLRLHE 650 (733)
T ss_pred ccceEEEehhHHHHHHHHhcCCeeeeeeeecCCCCeEEEecCCCe-eEEEEcccC--------------cchhHHhhhhh
Confidence 357999999998888888877788999999999999999999987 789998864 11233224444
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
. .|++++|.+-=..||+||.|||++||--
T Consensus 651 ~-avr~Va~H~ryPLfas~sdDgtv~Vfhg 679 (733)
T KOG0650|consen 651 K-AVRSVAFHKRYPLFASGSDDGTVIVFHG 679 (733)
T ss_pred h-hhhhhhhccccceeeeecCCCcEEEEee
Confidence 3 4999999999999999999999999953
No 155
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=99.01 E-value=2.1e-07 Score=105.64 Aligned_cols=101 Identities=17% Similarity=0.288 Sum_probs=78.2
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
+++-+...|.-.|.|.++...+..-.. +.++++|+|+|||.+||.||.|+. |.||.+... .....
T Consensus 420 ~va~Gt~~G~w~V~d~e~~~lv~~~~d-~~~ls~v~ysp~G~~lAvgs~d~~-iyiy~Vs~~-------------g~~y~ 484 (626)
T KOG2106|consen 420 VVAVGTATGRWFVLDTETQDLVTIHTD-NEQLSVVRYSPDGAFLAVGSHDNH-IYIYRVSAN-------------GRKYS 484 (626)
T ss_pred eEEEeeccceEEEEecccceeEEEEec-CCceEEEEEcCCCCEEEEecCCCe-EEEEEECCC-------------CcEEE
Confidence 344455678889999999555444344 899999999999999999999987 999999864 12222
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
++ +-.+.+.|+.+.||+|++||.+-|.|-.+-.|+-
T Consensus 485 r~-~k~~gs~ithLDwS~Ds~~~~~~S~d~eiLyW~~ 520 (626)
T KOG2106|consen 485 RV-GKCSGSPITHLDWSSDSQFLVSNSGDYEILYWKP 520 (626)
T ss_pred Ee-eeecCceeEEeeecCCCceEEeccCceEEEEEcc
Confidence 22 1222267999999999999999999999999943
No 156
>KOG4328 consensus WD40 protein [Function unknown]
Probab=98.99 E-value=2.2e-08 Score=112.59 Aligned_cols=109 Identities=18% Similarity=0.169 Sum_probs=74.5
Q ss_pred cccCCCCEEEEEECCCCc----eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 384 PDADNVGMVIVRDIVSKN----VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~----~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
++++.+++++|||+.... ++-..-.|..+|.+..|||+|-.|+|.+.|.+ |||||..-- . ....+.....|
T Consensus 339 aT~s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~TT~~D~~-IRv~dss~~--s--a~~~p~~~I~H 413 (498)
T KOG4328|consen 339 ATASLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLLTTCQDNE-IRVFDSSCI--S--AKDEPLGTIPH 413 (498)
T ss_pred eecccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceEeeccCCc-eEEeecccc--c--ccCCccceeec
Confidence 345668899999997643 33445589999999999998777999999976 999998411 0 00111112222
Q ss_pred EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
-...-|-. .+...+|.||..+|++|-.-.-|-|||-+-
T Consensus 414 n~~t~Rwl---T~fKA~W~P~~~li~vg~~~r~IDv~~~~~ 451 (498)
T KOG4328|consen 414 NNRTGRWL---TPFKAAWDPDYNLIVVGRYPRPIDVFDGNG 451 (498)
T ss_pred cCcccccc---cchhheeCCCccEEEEeccCcceeEEcCCC
Confidence 11111111 145678999999999999999999988543
No 157
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=98.98 E-value=1.1e-08 Score=115.16 Aligned_cols=121 Identities=17% Similarity=0.204 Sum_probs=87.2
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCcc----CCCCcee
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSAC----DAGTSYV 458 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~----~~~~~~~ 458 (921)
+.+...|.++++||+..+.++.++. ...+|.+++.+|-++.+..|..+|. |-+.++..- .+. +.+ +......
T Consensus 191 l~TaS~D~t~k~wdlS~g~LLlti~-fp~si~av~lDpae~~~yiGt~~G~-I~~~~~~~~-~~~-~~~v~~k~~~~~~t 266 (476)
T KOG0646|consen 191 LYTASEDRTIKLWDLSLGVLLLTIT-FPSSIKAVALDPAERVVYIGTEEGK-IFQNLLFKL-SGQ-SAGVNQKGRHEENT 266 (476)
T ss_pred EEEecCCceEEEEEeccceeeEEEe-cCCcceeEEEcccccEEEecCCcce-EEeeehhcC-Ccc-cccccccccccccc
Confidence 3456778999999999999887775 3468999999999999999999996 666666542 110 000 0000111
Q ss_pred EEEEEeccccc-ccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 459 HLYRLQRGLTN-AVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 459 ~l~~l~RG~t~-a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
.+..+ -|+.. ..|+|++.|-||..|++|+.||+|.|||+.......++.
T Consensus 267 ~~~~~-~Gh~~~~~ITcLais~DgtlLlSGd~dg~VcvWdi~S~Q~iRtl~ 316 (476)
T KOG0646|consen 267 QINVL-VGHENESAITCLAISTDGTLLLSGDEDGKVCVWDIYSKQCIRTLQ 316 (476)
T ss_pred eeeee-ccccCCcceeEEEEecCccEEEeeCCCCCEEEEecchHHHHHHHh
Confidence 22233 35444 359999999999999999999999999998876655554
No 158
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.98 E-value=5.5e-09 Score=110.74 Aligned_cols=71 Identities=21% Similarity=0.314 Sum_probs=58.5
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
-.|..+..-||++.||||+.||+ ||||...+. ..+..|. .+.+-|+++||+||...+|.+|.|
T Consensus 252 pGv~gvrIRpD~KIlATAGWD~R-iRVyswrtl--------------~pLAVLk--yHsagvn~vAfspd~~lmAaaskD 314 (323)
T KOG0322|consen 252 PGVSGVRIRPDGKILATAGWDHR-IRVYSWRTL--------------NPLAVLK--YHSAGVNAVAFSPDCELMAAASKD 314 (323)
T ss_pred CCccceEEccCCcEEeecccCCc-EEEEEeccC--------------Cchhhhh--hhhcceeEEEeCCCCchhhhccCC
Confidence 35777889999999999999998 999998875 2222332 123559999999999999999999
Q ss_pred CcEEEEec
Q 002446 491 GTSHLFAI 498 (921)
Q Consensus 491 gTVhVWdi 498 (921)
++|-+|++
T Consensus 315 ~rISLWkL 322 (323)
T KOG0322|consen 315 ARISLWKL 322 (323)
T ss_pred ceEEeeec
Confidence 99999997
No 159
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=98.98 E-value=1.8e-09 Score=119.76 Aligned_cols=130 Identities=15% Similarity=0.243 Sum_probs=98.7
Q ss_pred ccccCCCCEEEEEECCCC---------ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC--CCCCcc
Q 002446 383 FPDADNVGMVIVRDIVSK---------NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL--GTSSAC 451 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~---------~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~--~~~s~~ 451 (921)
+++++.|..|+||-+... .-+..|..|..+|+++.|+|+|.+||+|+++|. |.+|....-.. ... ..
T Consensus 29 laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~-v~lWk~~~~~~~~~d~-e~ 106 (434)
T KOG1009|consen 29 LATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGE-VFLWKQGDVRIFDADT-EA 106 (434)
T ss_pred eecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCce-EEEEEecCcCCccccc-hh
Confidence 456677889999987532 235677899999999999999999999999997 89997662100 000 01
Q ss_pred CCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 452 DAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 452 ~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
+.....+.+++.-||| ...|++++|+||+.++++++.|.++++||++.+.-...+..|..-+.
T Consensus 107 ~~~ke~w~v~k~lr~h-~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~~~dh~~yvq 169 (434)
T KOG1009|consen 107 DLNKEKWVVKKVLRGH-RDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAILDDHEHYVQ 169 (434)
T ss_pred hhCccceEEEEEeccc-ccchhhhhccCCCceeeeeeccceEEEEEeccceeEeeccccccccc
Confidence 1112345566666775 35699999999999999999999999999999877777888866666
No 160
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.97 E-value=7.8e-09 Score=112.76 Aligned_cols=104 Identities=19% Similarity=0.288 Sum_probs=77.4
Q ss_pred CCEEEEEECCCCce-EEEe-ccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 389 VGMVIVRDIVSKNV-IAQF-RAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 389 ~G~V~IwDl~s~~~-l~~~-~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
+-.|.+||++..+. +..+ ..|..-|++|+|.| |-.+|+|||.||- |+|||+...... .... ..+.
T Consensus 142 ~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLlSGSvDGL-vnlfD~~~d~Ee--------DaL~--~viN- 209 (376)
T KOG1188|consen 142 DASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDPNLLLSGSVDGL-VNLFDTKKDNEE--------DALL--HVIN- 209 (376)
T ss_pred ceEEEEEEeccccchhhhhhhhccCcceeEEecCCCCCeEEeecccce-EEeeecCCCcch--------hhHH--Hhhc-
Confidence 45699999998654 5544 59999999999999 4679999999995 999999865110 1112 2222
Q ss_pred ccccccEEEEEEccCC-CEEEEEeCCCcEEEEecCCCCCcee
Q 002446 466 GLTNAVIQDISFSDDS-NWIMISSSRGTSHLFAINPLGGSVN 506 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg-~~LAsgS~DgTVhVWdi~~~g~~~~ 506 (921)
+.+.|-+|.|.-++ +.|.+-+...|..+|+++...+...
T Consensus 210 --~~sSI~~igw~~~~ykrI~clTH~Etf~~~ele~~~~~~~ 249 (376)
T KOG1188|consen 210 --HGSSIHLIGWLSKKYKRIMCLTHMETFAIYELEDGSEETW 249 (376)
T ss_pred --ccceeeeeeeecCCcceEEEEEccCceeEEEccCCChhhc
Confidence 22349999998888 4578888899999999998764443
No 161
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=98.97 E-value=9.9e-10 Score=129.07 Aligned_cols=213 Identities=15% Similarity=0.144 Sum_probs=135.5
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
++++..||+|++||+...+...++.+....|..|+|+| .+..+|++.+.|. +++||+... .++..
T Consensus 149 liSGSQDg~vK~~DlR~~~S~~t~~~nSESiRDV~fsp~~~~~F~s~~dsG~-lqlWDlRqp-------------~r~~~ 214 (839)
T KOG0269|consen 149 LISGSQDGTVKCWDLRSKKSKSTFRSNSESIRDVKFSPGYGNKFASIHDSGY-LQLWDLRQP-------------DRCEK 214 (839)
T ss_pred EEecCCCceEEEEeeecccccccccccchhhhceeeccCCCceEEEecCCce-EEEeeccCc-------------hhHHH
Confidence 45788999999999999999999999999999999999 5889999999886 899999864 11212
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcccccCCcCCccccCCCCCCCCCCCCcc
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFTTKHGAMAKSGVRWPPNLGLQMPNQQS 541 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~~~~~~~~~~~~r~~~~s~l~~~~~~~ 541 (921)
+| .-+...|.|+.|+|+..|||+|+.|++|+||++...........|+ ..|++. ++|-|-. +.+
T Consensus 215 k~--~AH~GpV~c~nwhPnr~~lATGGRDK~vkiWd~t~~~~~~~~tInT-------iapv~r-VkWRP~~------~~h 278 (839)
T KOG0269|consen 215 KL--TAHNGPVLCLNWHPNREWLATGGRDKMVKIWDMTDSRAKPKHTINT-------IAPVGR-VKWRPAR------SYH 278 (839)
T ss_pred Hh--hcccCceEEEeecCCCceeeecCCCccEEEEeccCCCccceeEEee-------cceeee-eeeccCc------cch
Confidence 22 2233469999999999999999999999999998643333333332 122322 3444332 223
Q ss_pred cccCCCceeee--eeeEEecCCCCCCccccchhhhccCCccCCCcceeeeeeccCC-----CccccccCCcccccccEEE
Q 002446 542 LCASGPPVTLS--VVSRIRNGNNGWRGTVSGAAAAATGRVSSLSGAIASSFHNCKG-----NSETYAAGSSLKIKNHLLV 614 (921)
Q Consensus 542 l~~~~~pv~ls--~v~rI~~~~~~w~~~v~~~~~~~~~~~~~~~g~~~~~~~~~~~-----~~~~~~~~~~~~~~~~L~v 614 (921)
|+ .-+-|.=. -|=-||++= |+..--.|.. --| ++ ..-+-||-
T Consensus 279 LA-tcsmv~dtsV~VWDvrRPY------------------------IP~~t~~eH~~~vt~i~W---~~---~d~~~l~s 327 (839)
T KOG0269|consen 279 LA-TCSMVVDTSVHVWDVRRPY------------------------IPYATFLEHTDSVTGIAW---DS---GDRINLWS 327 (839)
T ss_pred hh-hhhccccceEEEEeecccc------------------------ccceeeeccCccccceec---cC---CCceeeEe
Confidence 32 11111000 011222221 2211112211 113 11 25567888
Q ss_pred EccCCcEEEEeeecccCCCcccCCCCCCCC-CCCCCCCCceEEEeeee
Q 002446 615 FSPSGCMIQYALRISTGLDVTMGVPGLGSA-YDSVPEDDPRLVVEAIQ 661 (921)
Q Consensus 615 ~sp~G~liqy~L~p~~~~~~~~~~~~~~~~-~~~~~~~~~~~~vep~~ 661 (921)
.+-+|.+.|+..+-...+-..+ +.. ..-.++-++-+.|+|+.
T Consensus 328 ~sKD~tv~qh~~knat~pid~a-----~~~~~s~g~~g~l~fa~n~~~ 370 (839)
T KOG0269|consen 328 CSKDGTVLQHLFKNATTPIDLA-----NNGGLSVGQFGDLYFAVNPEL 370 (839)
T ss_pred ecCccHHHHhhhhcccChhhhc-----CcccccccccCceeEEecccc
Confidence 9999999999887654433322 222 23348888999999876
No 162
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=98.92 E-value=6.1e-08 Score=114.84 Aligned_cols=102 Identities=10% Similarity=0.257 Sum_probs=81.1
Q ss_pred ccccCCCCEEEEEECC-CCceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 383 FPDADNVGMVIVRDIV-SKNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~-s~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
|.+++ |.+|+||.-. ...++..+..+...|++++|||- -..+|+++.||+ |.|||+.....+. +
T Consensus 414 fls~g-DW~vriWs~~~~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~-l~iWDLl~~~~~P------------v 479 (555)
T KOG1587|consen 414 FLSVG-DWTVRIWSEDVIASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGN-LDIWDLLQDDEEP------------V 479 (555)
T ss_pred eeeec-cceeEeccccCCCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCc-eehhhhhccccCC------------c
Confidence 33433 8899999998 77888899999999999999996 578999999997 9999998752211 1
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.+...+ ......+.|+++|+.||+|...|++|+|++.+
T Consensus 480 ~s~~~~--~~~l~~~~~s~~g~~lavGd~~G~~~~~~l~~ 517 (555)
T KOG1587|consen 480 LSQKVC--SPALTRVRWSPNGKLLAVGDANGTTHILKLSE 517 (555)
T ss_pred cccccc--ccccceeecCCCCcEEEEecCCCcEEEEEcCc
Confidence 222222 23477888999999999999999999999964
No 163
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.91 E-value=5e-09 Score=120.53 Aligned_cols=99 Identities=22% Similarity=0.304 Sum_probs=81.9
Q ss_pred cCCCCEEEEEECCCC-------ceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 386 ADNVGMVIVRDIVSK-------NVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~-------~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
+..+|.|+||-+..+ ++...+.+|...|+.|.|.|- ...||+++.|-| |+|||+...
T Consensus 646 a~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~asyd~T-i~lWDl~~~-------------- 710 (1012)
T KOG1445|consen 646 ATDDGQINLWRLTANGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVASYDST-IELWDLANA-------------- 710 (1012)
T ss_pred cccCceEEEEEeccCCCCcccCCcceeeecccceEEEEEecchhhhHhhhhhccce-eeeeehhhh--------------
Confidence 467899999998753 466788999999999999995 668999999987 999999975
Q ss_pred eEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 458 VHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
....+| -||+. .|.++||||||+.+|+.+.||+++||.-...
T Consensus 711 ~~~~~l-~gHtd-qIf~~AWSpdGr~~AtVcKDg~~rVy~Prs~ 752 (1012)
T KOG1445|consen 711 KLYSRL-VGHTD-QIFGIAWSPDGRRIATVCKDGTLRVYEPRSR 752 (1012)
T ss_pred hhhhee-ccCcC-ceeEEEECCCCcceeeeecCceEEEeCCCCC
Confidence 111233 46654 4999999999999999999999999986653
No 164
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.88 E-value=1.4e-06 Score=100.98 Aligned_cols=103 Identities=17% Similarity=0.163 Sum_probs=65.2
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC--CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG--HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.++|+.+++. ..+..+.....+.+|+|||++|+.++.++ ..|.+||+.++ .. ..+..+.
T Consensus 312 ~Iy~~d~~~g~~-~~lt~~~~~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~~g------------~~---~~Lt~~~- 374 (429)
T PRK03629 312 QVYKVNINGGAP-QRITWEGSQNQDADVSSDGKFMVMVSSNGGQQHIAKQDLATG------------GV---QVLTDTF- 374 (429)
T ss_pred eEEEEECCCCCe-EEeecCCCCccCEEECCCCCEEEEEEccCCCceEEEEECCCC------------Ce---EEeCCCC-
Confidence 355567766644 33443444566789999999998876543 24777888765 11 2232221
Q ss_pred cccEEEEEEccCCCEEEEEeCCCc---EEEEecCCCCCceeecCCCCC
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGT---SHLFAINPLGGSVNFQPTDAN 513 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgT---VhVWdi~~~g~~~~l~~H~~~ 513 (921)
...+.+|||||++|+.++.++. +.++++ +++....+.+|.+.
T Consensus 375 --~~~~p~~SpDG~~i~~~s~~~~~~~l~~~~~-~G~~~~~l~~~~~~ 419 (429)
T PRK03629 375 --LDETPSIAPNGTMVIYSSSQGMGSVLNLVST-DGRFKARLPATDGQ 419 (429)
T ss_pred --CCCCceECCCCCEEEEEEcCCCceEEEEEEC-CCCCeEECccCCCC
Confidence 2346889999999999998876 455555 33344566666443
No 165
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.86 E-value=9e-08 Score=102.73 Aligned_cols=117 Identities=16% Similarity=0.217 Sum_probs=76.5
Q ss_pred ccccCCCCEEEEEECCC-CceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCC-------CCCccCC
Q 002446 383 FPDADNVGMVIVRDIVS-KNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILG-------TSSACDA 453 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s-~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~-------~~s~~~~ 453 (921)
+++++.+|.|+|||... +.++..+.+|..-|.++.|+|. .++|.|++.|.. +.+|....-... ..+...-
T Consensus 230 lvt~gDdgyvriWD~R~tk~pv~el~~HsHWvW~VRfn~~hdqLiLs~~SDs~-V~Lsca~svSSE~qi~~~~dese~e~ 308 (370)
T KOG1007|consen 230 LVTCGDDGYVRIWDTRKTKFPVQELPGHSHWVWAVRFNPEHDQLILSGGSDSA-VNLSCASSVSSEQQIEFEDDESESED 308 (370)
T ss_pred EEEcCCCccEEEEeccCCCccccccCCCceEEEEEEecCccceEEEecCCCce-eEEEeccccccccccccccccccCcc
Confidence 34567889999999985 5688999999999999999996 778999999975 888865442100 0000000
Q ss_pred CCceeEEEEEecc------cccccEEEEEEccCCCE-EEEEeCCCcEEEEecCC
Q 002446 454 GTSYVHLYRLQRG------LTNAVIQDISFSDDSNW-IMISSSRGTSHLFAINP 500 (921)
Q Consensus 454 ~~~~~~l~~l~RG------~t~a~I~sIaFSPDg~~-LAsgS~DgTVhVWdi~~ 500 (921)
........-|.-| .+.-.|++++||.-.-| ||+=|-||.+.|=.+.+
T Consensus 309 ~dseer~kpL~dg~l~tydehEDSVY~~aWSsadPWiFASLSYDGRviIs~V~r 362 (370)
T KOG1007|consen 309 EDSEERVKPLQDGQLETYDEHEDSVYALAWSSADPWIFASLSYDGRVIISSVPR 362 (370)
T ss_pred hhhHHhcccccccccccccccccceEEEeeccCCCeeEEEeccCceEEeecCCh
Confidence 0000110111111 12224999999765555 67889999998876654
No 166
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.86 E-value=1.3e-08 Score=106.98 Aligned_cols=114 Identities=18% Similarity=0.338 Sum_probs=89.7
Q ss_pred ccccCCCCEEEEEECCCC---ceEEEeccCCCCeEEEEECC--CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 383 FPDADNVGMVIVRDIVSK---NVIAQFRAHKSPISALCFDP--SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~---~~l~~~~aH~~pIsaLaFSP--dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
++++..|++|+|++..+. +++.+|.+|.+||..++|-. -|++||+||.||+ |.||.-..+ .+.
T Consensus 26 lATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iLAScsYDgk-VIiWke~~g-~w~---------- 93 (299)
T KOG1332|consen 26 LATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAHPKFGTILASCSYDGK-VIIWKEENG-RWT---------- 93 (299)
T ss_pred eeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecccccCcEeeEeecCce-EEEEecCCC-chh----------
Confidence 456778999999999864 57899999999999999988 8999999999998 789987765 211
Q ss_pred eEEEEEecccccccEEEEEEccC--CCEEEEEeCCCcEEEEecCCCCCce---eecCCC
Q 002446 458 VHLYRLQRGLTNAVIQDISFSDD--SNWIMISSSRGTSHLFAINPLGGSV---NFQPTD 511 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sIaFSPD--g~~LAsgS~DgTVhVWdi~~~g~~~---~l~~H~ 511 (921)
+.++ +..+.+.|++|+|.|. |-.||++|+||+|.|+++...++-. ..+.|.
T Consensus 94 -k~~e--~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~g~w~t~ki~~aH~ 149 (299)
T KOG1332|consen 94 -KAYE--HAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSSGGWTTSKIVFAHE 149 (299)
T ss_pred -hhhh--hhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCCCCccchhhhhccc
Confidence 2222 2234566999999885 6789999999999999998875432 235663
No 167
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=98.85 E-value=7.6e-09 Score=112.37 Aligned_cols=100 Identities=22% Similarity=0.369 Sum_probs=85.1
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
.++.-|.|+|.|+.++++...+.+|..+|+.|+|.|+ -++|++||.|. .||+|++.+. .++..+
T Consensus 110 ~~G~~GvIrVid~~~~~~~~~~~ghG~sINeik~~p~~~qlvls~SkD~-svRlwnI~~~--------------~Cv~Vf 174 (385)
T KOG1034|consen 110 AGGYLGVIRVIDVVSGQCSKNYRGHGGSINEIKFHPDRPQLVLSASKDH-SVRLWNIQTD--------------VCVAVF 174 (385)
T ss_pred eecceeEEEEEecchhhhccceeccCccchhhhcCCCCCcEEEEecCCc-eEEEEeccCC--------------eEEEEe
Confidence 3456799999999999999999999999999999997 47999999995 5999999986 344333
Q ss_pred --ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 464 --QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 464 --~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
..||. ..|.++.|++||.+||++++|.++++|+++.
T Consensus 175 GG~egHr-deVLSvD~~~~gd~i~ScGmDhslk~W~l~~ 212 (385)
T KOG1034|consen 175 GGVEGHR-DEVLSVDFSLDGDRIASCGMDHSLKLWRLNV 212 (385)
T ss_pred ccccccc-CcEEEEEEcCCCCeeeccCCcceEEEEecCh
Confidence 22332 2499999999999999999999999999984
No 168
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.81 E-value=1.7e-06 Score=95.75 Aligned_cols=198 Identities=19% Similarity=0.284 Sum_probs=130.2
Q ss_pred EEEEECCCCcEEEEEeCC----CCEEEEEEcC--CEEEE---EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcc
Q 002446 208 VHFYSLRSQSYVHMLKFR----SPIYSVRCSS--RVVAI---CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIG 278 (921)
Q Consensus 208 VrIWDL~Tg~~V~tL~f~----s~V~sV~~S~--riLAV---a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~ 278 (921)
|.|||+++-+.+++|.-. ..+.++..|. -+||. ...+.|++||+.+++..-++..|..
T Consensus 108 IyIydI~~MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~aH~~------------- 174 (391)
T KOG2110|consen 108 IYIYDIKDMKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTINAHKG------------- 174 (391)
T ss_pred EEEEecccceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEEecCC-------------
Confidence 899999999999999752 3466666664 48887 2357999999999999888887742
Q ss_pred ccceeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccc
Q 002446 279 YGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEF 358 (921)
Q Consensus 279 ~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~ 358 (921)
++| -|||.. .|.++
T Consensus 175 --~lA----alafs~---------------------------~G~ll--------------------------------- 188 (391)
T KOG2110|consen 175 --PLA----ALAFSP---------------------------DGTLL--------------------------------- 188 (391)
T ss_pred --cee----EEEECC---------------------------CCCEE---------------------------------
Confidence 343 255541 12221
Q ss_pred cCCCcCCcccccCCCCCCCcccCcccccCCCC-EEEEEECCCCceEEEeccCC--CCeEEEEECCCCCEEEEEecCCCEE
Q 002446 359 LPDSQNSLQSAIPGGKSNGTVNGHFPDADNVG-MVIVRDIVSKNVIAQFRAHK--SPISALCFDPSGILLVTASVQGHNI 435 (921)
Q Consensus 359 ~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G-~V~IwDl~s~~~l~~~~aH~--~pIsaLaFSPdGtlLATaS~DGt~I 435 (921)
+++...| .|||+++.+|+.+.+|+.-. ..|.+|+|+||+++|+..|..+| |
T Consensus 189 -------------------------ATASeKGTVIRVf~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~sS~TeT-V 242 (391)
T KOG2110|consen 189 -------------------------ATASEKGTVIRVFSVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAASSNTET-V 242 (391)
T ss_pred -------------------------EEeccCceEEEEEEcCCccEeeeeeCCceeeEEEEEEECCCCCeEEEecCCCe-E
Confidence 1112223 58999999999999999554 35889999999999999999988 9
Q ss_pred EEEeCCCCCC---C-CCCccCCC------------CceeEEEEEecccccccE------EEEEEc--cCCCEEEEEeCCC
Q 002446 436 NIFKIIPGIL---G-TSSACDAG------------TSYVHLYRLQRGLTNAVI------QDISFS--DDSNWIMISSSRG 491 (921)
Q Consensus 436 rIWdi~~g~~---~-~~s~~~~~------------~~~~~l~~l~RG~t~a~I------~sIaFS--PDg~~LAsgS~Dg 491 (921)
+||.+..... . +....++. ..+..++...|-+-.++| ..++|+ ++..++.+++.||
T Consensus 243 HiFKL~~~~~~~~~~p~~~~~~~~~~sk~~~sylps~V~~~~~~~R~FAt~~l~~s~~~~~~~l~~~~~~~~v~vas~dG 322 (391)
T KOG2110|consen 243 HIFKLEKVSNNPPESPTAGTSWFGKVSKAATSYLPSQVSSVLDQSRKFATAKLPESGRKNICSLSSIQKIPRVLVASYDG 322 (391)
T ss_pred EEEEecccccCCCCCCCCCCcccchhhhhhhhhcchhhhhhhhhccceeEEEccCCCccceEEeeccCCCCEEEEEEcCC
Confidence 9999876421 0 00001110 011111122222211111 244555 5889999999999
Q ss_pred cEEEEecCCC-CCce-eecCC
Q 002446 492 TSHLFAINPL-GGSV-NFQPT 510 (921)
Q Consensus 492 TVhVWdi~~~-g~~~-~l~~H 510 (921)
.+..|.+.+. +|.. .+..|
T Consensus 323 ~~y~y~l~~~~gGec~lik~h 343 (391)
T KOG2110|consen 323 HLYSYRLPPKEGGECALIKRH 343 (391)
T ss_pred eEEEEEcCCCCCceeEEEEee
Confidence 9999999873 4444 44555
No 169
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=98.80 E-value=1.4e-07 Score=109.51 Aligned_cols=101 Identities=11% Similarity=0.127 Sum_probs=70.9
Q ss_pred CCCEEEEEECCCC--ceEEEeccCCCC-e-EEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 388 NVGMVIVRDIVSK--NVIAQFRAHKSP-I-SALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 388 ~~G~V~IwDl~s~--~~l~~~~aH~~p-I-saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
.|+.|..|++.+. .+++.|.+|... + ..-..+|||.+|++++.|++ ..||.+.... .. -.+
T Consensus 291 tD~sIy~ynm~s~s~sP~~~~sg~~~~sf~vks~lSpd~~~l~SgSsd~~-ayiw~vs~~e-~~-------------~~~ 355 (720)
T KOG0321|consen 291 TDNSIYFYNMRSLSISPVAEFSGKLNSSFYVKSELSPDDCSLLSGSSDEQ-AYIWVVSSPE-AP-------------PAL 355 (720)
T ss_pred cCCcEEEEeccccCcCchhhccCcccceeeeeeecCCCCceEeccCCCcc-eeeeeecCcc-CC-------------hhh
Confidence 3789999999764 456666665421 1 12357999999999999987 8999998641 00 122
Q ss_pred ecccccccEEEEEEcc--CCCEEEEEeCCCcEEEEecCCCCCce
Q 002446 464 QRGLTNAVIQDISFSD--DSNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSP--Dg~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
.-||+. .|++++|.| ++. +|++|+|-+++||++..+.+..
T Consensus 356 l~Ght~-eVt~V~w~pS~~t~-v~TcSdD~~~kiW~l~~~l~e~ 397 (720)
T KOG0321|consen 356 LLGHTR-EVTTVRWLPSATTP-VATCSDDFRVKIWRLSNGLEEI 397 (720)
T ss_pred hhCcce-EEEEEeeccccCCC-ceeeccCcceEEEeccCchhhc
Confidence 236543 489999955 555 5555999999999998765544
No 170
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=98.80 E-value=1.3e-06 Score=92.94 Aligned_cols=99 Identities=25% Similarity=0.447 Sum_probs=78.8
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
.++.+++||+..+..+..+..|...|.+++|+|+|. ++++++.|++ |++||...+ ..+.....+
T Consensus 176 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~~~~~~~~~~~d~~-i~~wd~~~~--------------~~~~~~~~~ 240 (466)
T COG2319 176 LDGTIKLWDLRTGKPLSTLAGHTDPVSSLAFSPDGGLLIASGSSDGT-IRLWDLSTG--------------KLLRSTLSG 240 (466)
T ss_pred CCCceEEEEcCCCceEEeeccCCCceEEEEEcCCcceEEEEecCCCc-EEEEECCCC--------------cEEeeecCC
Confidence 368999999999999999999999999999999998 6666689987 789987743 222212344
Q ss_pred cccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCC
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
+... . ...|+|++.++++++.|+++++|++.....
T Consensus 241 ~~~~-~-~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~ 275 (466)
T COG2319 241 HSDS-V-VSSFSPDGSLLASGSSDGTIRLWDLRSSSS 275 (466)
T ss_pred CCcc-e-eEeECCCCCEEEEecCCCcEEEeeecCCCc
Confidence 4332 2 228999999999999999999999987655
No 171
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.79 E-value=3.3e-08 Score=117.04 Aligned_cols=280 Identities=16% Similarity=0.235 Sum_probs=172.0
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccCc-EEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRSG-FQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~G-fqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
..-+|..-|.++-||+ .| +.++.||++- ++||..++ +.+..-+.+|.|.++-+++.-+
T Consensus 185 rLlgH~naVyca~fDr---tg----~~Iitgsdd~lvKiwS~et-~~~lAs~rGhs~ditdlavs~~------------- 243 (1113)
T KOG0644|consen 185 RLLGHRNAVYCAIFDR---TG----RYIITGSDDRLVKIWSMET-ARCLASCRGHSGDITDLAVSSN------------- 243 (1113)
T ss_pred HHHhhhhheeeeeecc---cc----ceEeecCccceeeeeeccc-hhhhccCCCCccccchhccchh-------------
Confidence 4457899999999999 66 7888888776 69999887 3454456678888877665321
Q ss_pred CCCE-EEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEe-CCCCEEEEEEcCCEEE
Q 002446 162 VRPL-LVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLK-FRSPIYSVRCSSRVVA 239 (921)
Q Consensus 162 ~rPL-LAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~-f~s~V~sV~~S~riLA 239 (921)
++ +|.. ..++.||+|-|.++..|..|. +.+.|.+|+|+++- +
T Consensus 244 --n~~iaaa---------------------------------S~D~vIrvWrl~~~~pvsvLrghtgavtaiafsP~~-s 287 (1113)
T KOG0644|consen 244 --NTMIAAA---------------------------------SNDKVIRVWRLPDGAPVSVLRGHTGAVTAIAFSPRA-S 287 (1113)
T ss_pred --hhhhhhc---------------------------------ccCceEEEEecCCCchHHHHhccccceeeeccCccc-c
Confidence 22 2211 134889999999999999886 46799999999875 5
Q ss_pred EEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCccCCccccccccccccc
Q 002446 240 ICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFA 319 (921)
Q Consensus 240 Va~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~ 319 (921)
.+.++++++||++ +..+ ...|.+.... ++ .+ +..+-+-..|-+|.+ |+-
T Consensus 288 ss~dgt~~~wd~r-~~~~---~y~prp~~~~--~~-~~-~~s~~~~~~~~~f~T--------gs~--------------- 336 (1113)
T KOG0644|consen 288 SSDDGTCRIWDAR-LEPR---IYVPRPLKFT--EK-DL-VDSILFENNGDRFLT--------GSR--------------- 336 (1113)
T ss_pred CCCCCceEecccc-cccc---ccCCCCCCcc--cc-cc-eeeeecccccccccc--------ccC---------------
Confidence 5778999999998 2222 1122111000 00 00 000000011122210 000
Q ss_pred CCCcceeehhhhcchhhcceeEecCCccccc-cccccccccCCCcCCcccccCCCCCCCcccCcccccCCCCEEEEEECC
Q 002446 320 SNGSRVAHYAKESSKHLAAGIVNLGDLGYKK-LSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIV 398 (921)
Q Consensus 320 s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~-ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~ 398 (921)
...++.+.+--..++. +..|. ... +..+...+++-.+-.+.+|.+.
T Consensus 337 ---------------d~ea~n~e~~~l~~~~~~lif~--------------t~s----sd~~~~~~~ar~~~~~~vwnl~ 383 (1113)
T KOG0644|consen 337 ---------------DGEARNHEFEQLAWRSNLLIFV--------------TRS----SDLSSIVVTARNDHRLCVWNLY 383 (1113)
T ss_pred ---------------CcccccchhhHhhhhccceEEE--------------ecc----ccccccceeeeeeeEeeeeecc
Confidence 0000000000000000 00000 000 0000011233445678899999
Q ss_pred CCceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE
Q 002446 399 SKNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF 477 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF 477 (921)
++.+++.+.+|..++..|.|.|= -+...+|+.||. +.|||+..+ ...+.|. .| ..++.+.+|
T Consensus 384 ~g~l~H~l~ghsd~~yvLd~Hpfn~ri~msag~dgs-t~iwdi~eg------------~pik~y~--~g--h~kl~d~kF 446 (1113)
T KOG0644|consen 384 TGQLLHNLMGHSDEVYVLDVHPFNPRIAMSAGYDGS-TIIWDIWEG------------IPIKHYF--IG--HGKLVDGKF 446 (1113)
T ss_pred cchhhhhhcccccceeeeeecCCCcHhhhhccCCCc-eEeeecccC------------Ccceeee--cc--cceeecccc
Confidence 99999999999999999999994 556667899997 689999886 1223343 34 345889999
Q ss_pred ccCCCEEEEEeCCCcEEEEecCC
Q 002446 478 SDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
|+||+-++..-+-|-+.|+..-.
T Consensus 447 Sqdgts~~lsd~hgql~i~g~gq 469 (1113)
T KOG0644|consen 447 SQDGTSIALSDDHGQLYILGTGQ 469 (1113)
T ss_pred CCCCceEecCCCCCceEEeccCC
Confidence 99999999999999998876543
No 172
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=98.78 E-value=7.1e-08 Score=104.14 Aligned_cols=116 Identities=13% Similarity=0.207 Sum_probs=88.3
Q ss_pred ccccCCCCEEEEEECCCCceEEEec--cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR--AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~--aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
++++..|++|+++|+........|+ ....+|.+|.|.|.|.+|+.|.+.-+ +|+||+.+.. +..-
T Consensus 187 LiS~srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~-~rlYdv~T~Q------------cfvs 253 (430)
T KOG0640|consen 187 LISGSRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPT-LRLYDVNTYQ------------CFVS 253 (430)
T ss_pred EEeccCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCc-eeEEecccee------------Eeee
Confidence 3466789999999998765555555 33469999999999999999888765 8999999851 1000
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee-cCCCC
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF-QPTDA 512 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l-~~H~~ 512 (921)
..-.-+++. .|+++-+|+.|++-+++|.||.|+|||=-...+..++ +.|.+
T Consensus 254 anPd~qht~-ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~rCv~t~~~AH~g 305 (430)
T KOG0640|consen 254 ANPDDQHTG-AITQVRYSSTGSLYVTASKDGAIKLWDGVSNRCVRTIGNAHGG 305 (430)
T ss_pred cCccccccc-ceeEEEecCCccEEEEeccCCcEEeeccccHHHHHHHHhhcCC
Confidence 111224443 4999999999999999999999999997777677666 56643
No 173
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=98.77 E-value=3.2e-07 Score=101.86 Aligned_cols=107 Identities=21% Similarity=0.238 Sum_probs=88.7
Q ss_pred ccccCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 383 FPDADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
|+++..-+.|++||...+ +++.+|.--..+|+++...|+|+++.+|...|. +..||+..+ .++.
T Consensus 219 fat~T~~hqvR~YDt~~qRRPV~~fd~~E~~is~~~l~p~gn~Iy~gn~~g~-l~~FD~r~~--------------kl~g 283 (412)
T KOG3881|consen 219 FATITRYHQVRLYDTRHQRRPVAQFDFLENPISSTGLTPSGNFIYTGNTKGQ-LAKFDLRGG--------------KLLG 283 (412)
T ss_pred EEEEecceeEEEecCcccCcceeEeccccCcceeeeecCCCcEEEEecccch-hheecccCc--------------eeec
Confidence 444455588999999875 688999888899999999999999999999997 899999876 3333
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCce
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
....|.+.+ |.+|.-.|..++||+++.|+-+||||+.+.+-..
T Consensus 284 ~~~kg~tGs-irsih~hp~~~~las~GLDRyvRIhD~ktrkll~ 326 (412)
T KOG3881|consen 284 CGLKGITGS-IRSIHCHPTHPVLASCGLDRYVRIHDIKTRKLLH 326 (412)
T ss_pred cccCCccCC-cceEEEcCCCceEEeeccceeEEEeecccchhhh
Confidence 333566554 9999999999999999999999999999855443
No 174
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=98.77 E-value=1.4e-06 Score=104.64 Aligned_cols=109 Identities=18% Similarity=0.269 Sum_probs=83.5
Q ss_pred cccCCCCEEEEEECCC--C--ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 384 PDADNVGMVIVRDIVS--K--NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s--~--~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
+.+..+|.|.||.--. + .....|.=|..+|.+|+|++||.+|.+|+..| .+-+|.+.++ ..+.
T Consensus 221 Aa~d~dGrI~vw~d~~~~~~~~t~t~lHWH~~~V~~L~fS~~G~~LlSGG~E~-VLv~Wq~~T~------------~kqf 287 (792)
T KOG1963|consen 221 AAGDSDGRILVWRDFGSSDDSETCTLLHWHHDEVNSLSFSSDGAYLLSGGREG-VLVLWQLETG------------KKQF 287 (792)
T ss_pred EEeccCCcEEEEeccccccccccceEEEecccccceeEEecCCceEeecccce-EEEEEeecCC------------Cccc
Confidence 4566789999995322 1 23456777889999999999999999999998 5889999986 1112
Q ss_pred EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
|.|- .+.|..|.+|||+.+.+....|+.||+-...+-....++.+-
T Consensus 288 ---LPRL--gs~I~~i~vS~ds~~~sl~~~DNqI~li~~~dl~~k~tIsgi 333 (792)
T KOG1963|consen 288 ---LPRL--GSPILHIVVSPDSDLYSLVLEDNQIHLIKASDLEIKSTISGI 333 (792)
T ss_pred ---cccc--CCeeEEEEEcCCCCeEEEEecCceEEEEeccchhhhhhccCc
Confidence 2221 356999999999999999999999999988765555555443
No 175
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=98.75 E-value=2.5e-08 Score=107.94 Aligned_cols=128 Identities=20% Similarity=0.298 Sum_probs=88.7
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCC-----CCCc--cCC-
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILG-----TSSA--CDA- 453 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~-----~~s~--~~~- 453 (921)
+++.+..+|.|.|||+.+..+-..|.+|..||++||||+||++|+|+|.|- .|.+||+..+... .++- ..+
T Consensus 37 ~lAvGc~nG~vvI~D~~T~~iar~lsaH~~pi~sl~WS~dgr~LltsS~D~-si~lwDl~~gs~l~rirf~spv~~~q~h 115 (405)
T KOG1273|consen 37 YLAVGCANGRVVIYDFDTFRIARMLSAHVRPITSLCWSRDGRKLLTSSRDW-SIKLWDLLKGSPLKRIRFDSPVWGAQWH 115 (405)
T ss_pred eeeeeccCCcEEEEEccccchhhhhhccccceeEEEecCCCCEeeeecCCc-eeEEEeccCCCceeEEEccCccceeeec
Confidence 455678899999999999998889999999999999999999999999996 5999999887220 0000 000
Q ss_pred -CCceeEE----------EEEec-----------ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 454 -GTSYVHL----------YRLQR-----------GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 454 -~~~~~~l----------~~l~R-----------G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
......+ ..+.- |.-+..-.+..|.+-|+|+.+|+.+|.++|++.++......++.-
T Consensus 116 p~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr~g~yIitGtsKGkllv~~a~t~e~vas~rit 194 (405)
T KOG1273|consen 116 PRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDRRGKYIITGTSKGKLLVYDAETLECVASFRIT 194 (405)
T ss_pred cccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccCCCCEEEEecCcceEEEEecchheeeeeeeec
Confidence 0000000 01100 000000112347788999999999999999999998777666543
No 176
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=98.74 E-value=4.3e-07 Score=106.37 Aligned_cols=113 Identities=19% Similarity=0.165 Sum_probs=76.5
Q ss_pred CEEEEEECC--CCceEEEeccCCCCeEEEEECCCCC---EEEEEecCCCEEEEEeCCCCCCCCC------CccCC-CCce
Q 002446 390 GMVIVRDIV--SKNVIAQFRAHKSPISALCFDPSGI---LLVTASVQGHNINIFKIIPGILGTS------SACDA-GTSY 457 (921)
Q Consensus 390 G~V~IwDl~--s~~~l~~~~aH~~pIsaLaFSPdGt---lLATaS~DGt~IrIWdi~~g~~~~~------s~~~~-~~~~ 457 (921)
-.|.||.-. +-+.+..+++|..-|..|+|..-|. +|||+|.|. .||||.+.......+ ...-. ....
T Consensus 169 ~~v~~~s~~~d~f~~v~el~GH~DWIrsl~f~~~~~~~~~laS~SQD~-yIRiW~i~~~~~~~~~~~e~~~t~~~~~~~f 247 (764)
T KOG1063|consen 169 FVVDLYSSSADSFARVAELEGHTDWIRSLAFARLGGDDLLLASSSQDR-YIRIWRIVLGDDEDSNEREDSLTTLSNLPVF 247 (764)
T ss_pred eEEEEeccCCcceeEEEEeeccchhhhhhhhhccCCCcEEEEecCCce-EEEEEEEEecCCccccccccccccccCCcee
Confidence 344454433 3357789999999999999998766 899999995 599999876521000 00000 0001
Q ss_pred eEEE---------EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 458 VHLY---------RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 458 ~~l~---------~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
..+. .+--||... |+++-|+|++..|.++|+|.|+.||.-.+..|.
T Consensus 248 ~~l~~i~~~is~eall~GHeDW-V~sv~W~p~~~~LLSASaDksmiiW~pd~~tGi 302 (764)
T KOG1063|consen 248 MILEEIQYRISFEALLMGHEDW-VYSVWWHPEGLDLLSASADKSMIIWKPDENTGI 302 (764)
T ss_pred eeeeeEEEEEehhhhhcCcccc-eEEEEEccchhhheecccCcceEEEecCCccce
Confidence 1111 122366554 999999999999999999999999987766443
No 177
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.74 E-value=6.3e-06 Score=95.62 Aligned_cols=81 Identities=16% Similarity=0.204 Sum_probs=53.9
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC--CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG--HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.++|+.+++. ..+..+...+...+|||||++||..+.++ ..|.+||+..+ ... .+..+.
T Consensus 315 ~Iy~~d~~g~~~-~~lt~~~~~~~~~~~SpdG~~ia~~~~~~~~~~i~~~d~~~~-------------~~~--~lt~~~- 377 (435)
T PRK05137 315 QLYVMNADGSNP-RRISFGGGRYSTPVWSPRGDLIAFTKQGGGQFSIGVMKPDGS-------------GER--ILTSGF- 377 (435)
T ss_pred eEEEEECCCCCe-EEeecCCCcccCeEECCCCCEEEEEEcCCCceEEEEEECCCC-------------ceE--eccCCC-
Confidence 578888876654 33443455667789999999999887543 24667776543 111 222221
Q ss_pred cccEEEEEEccCCCEEEEEeCC
Q 002446 469 NAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~D 490 (921)
.+.+++|||||++|+..+.+
T Consensus 378 --~~~~p~~spDG~~i~~~~~~ 397 (435)
T PRK05137 378 --LVEGPTWAPNGRVIMFFRQT 397 (435)
T ss_pred --CCCCCeECCCCCEEEEEEcc
Confidence 36789999999999887654
No 178
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=98.73 E-value=2.4e-08 Score=116.52 Aligned_cols=99 Identities=15% Similarity=0.330 Sum_probs=79.8
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
..|+||...+-..+..++.|.-.|+.|+|||||++|+++|.|.+ +.+|......... .. +..-..| .
T Consensus 552 AvI~lw~t~~W~~~~~L~~HsLTVT~l~FSpdg~~LLsvsRDRt-~sl~~~~~~~~~e---------~~--fa~~k~H-t 618 (764)
T KOG1063|consen 552 AVIRLWNTANWLQVQELEGHSLTVTRLAFSPDGRYLLSVSRDRT-VSLYEVQEDIKDE---------FR--FACLKAH-T 618 (764)
T ss_pred eEEEEEeccchhhhheecccceEEEEEEECCCCcEEEEeecCce-EEeeeeecccchh---------hh--hcccccc-c
Confidence 47999999998888899999999999999999999999999976 8999887641100 00 1111122 2
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
-.|++++|+||+++|||+|.|.+|+||.+...
T Consensus 619 RIIWdcsW~pde~~FaTaSRDK~VkVW~~~~~ 650 (764)
T KOG1063|consen 619 RIIWDCSWSPDEKYFATASRDKKVKVWEEPDL 650 (764)
T ss_pred eEEEEcccCcccceeEEecCCceEEEEeccCc
Confidence 24999999999999999999999999998764
No 179
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=98.72 E-value=1.5e-07 Score=104.39 Aligned_cols=118 Identities=13% Similarity=0.126 Sum_probs=89.1
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
.+++.+.+|.||++.+++.+-++. |..-|.+++|+.||.+|+|++.|.+ |||||..++ ..+.+-
T Consensus 148 lsag~Dn~v~iWnv~tgeali~l~-hpd~i~S~sfn~dGs~l~TtckDKk-vRv~dpr~~--------------~~v~e~ 211 (472)
T KOG0303|consen 148 LSAGSDNTVSIWNVGTGEALITLD-HPDMVYSMSFNRDGSLLCTTCKDKK-VRVIDPRRG--------------TVVSEG 211 (472)
T ss_pred hhccCCceEEEEeccCCceeeecC-CCCeEEEEEeccCCceeeeecccce-eEEEcCCCC--------------cEeeec
Confidence 455678899999999999988888 9999999999999999999999976 999999886 223333
Q ss_pred ecccccccEEEEEEccCCCEEEEEeC---CCcEEEEecCCCCC---ceeecCCCCCccccc
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSS---RGTSHLFAINPLGG---SVNFQPTDANFTTKH 518 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~---DgTVhVWdi~~~g~---~~~l~~H~~~~~~~~ 518 (921)
.+|..++-+-+-|=.+|.++-+|-+ +..+-|||-..-.+ ...+.+-++..-+|+
T Consensus 212 -~~heG~k~~Raifl~~g~i~tTGfsr~seRq~aLwdp~nl~eP~~~~elDtSnGvl~PFy 271 (472)
T KOG0303|consen 212 -VAHEGAKPARAIFLASGKIFTTGFSRMSERQIALWDPNNLEEPIALQELDTSNGVLLPFY 271 (472)
T ss_pred -ccccCCCcceeEEeccCceeeeccccccccceeccCcccccCcceeEEeccCCceEEeee
Confidence 4566666677889899995555543 56788998654433 344555555555544
No 180
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.71 E-value=4.6e-06 Score=96.76 Aligned_cols=91 Identities=14% Similarity=0.212 Sum_probs=55.8
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC--CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG--HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.++|+.+++.. .+..+......++|||||++|+..+.++ ..|.+||+.++ .. ..+..+.
T Consensus 317 ~iy~~dl~~g~~~-~lt~~g~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~~g------------~~---~~Lt~~~- 379 (433)
T PRK04922 317 QIYRVAASGGSAE-RLTFQGNYNARASVSPDGKKIAMVHGSGGQYRIAVMDLSTG------------SV---RTLTPGS- 379 (433)
T ss_pred eEEEEECCCCCeE-EeecCCCCccCEEECCCCCEEEEEECCCCceeEEEEECCCC------------Ce---EECCCCC-
Confidence 4666677666532 2222333455689999999999876543 24889998765 11 1332222
Q ss_pred cccEEEEEEccCCCEEEEEeCC-CcEEEEecCC
Q 002446 469 NAVIQDISFSDDSNWIMISSSR-GTSHLFAINP 500 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~D-gTVhVWdi~~ 500 (921)
.....+|||||++|+..+.+ +.-+||-+..
T Consensus 380 --~~~~p~~spdG~~i~~~s~~~g~~~L~~~~~ 410 (433)
T PRK04922 380 --LDESPSFAPNGSMVLYATREGGRGVLAAVST 410 (433)
T ss_pred --CCCCceECCCCCEEEEEEecCCceEEEEEEC
Confidence 24567999999998887764 3434444433
No 181
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=98.70 E-value=1.5e-07 Score=97.92 Aligned_cols=91 Identities=15% Similarity=0.357 Sum_probs=71.4
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC---CCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ---GHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D---Gt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
..+..|.+||+. .+.+..|. ..++..|+|||+|++||+|+.+ |. +.+||+... ..+.+.
T Consensus 80 ~~~~~v~lyd~~-~~~i~~~~--~~~~n~i~wsP~G~~l~~~g~~n~~G~-l~~wd~~~~--------------~~i~~~ 141 (194)
T PF08662_consen 80 SMPAKVTLYDVK-GKKIFSFG--TQPRNTISWSPDGRFLVLAGFGNLNGD-LEFWDVRKK--------------KKISTF 141 (194)
T ss_pred cCCcccEEEcCc-ccEeEeec--CCCceEEEECCCCCEEEEEEccCCCcE-EEEEECCCC--------------EEeecc
Confidence 345689999997 56666664 5688999999999999999854 43 899999864 444444
Q ss_pred ecccccccEEEEEEccCCCEEEEEeC------CCcEEEEecC
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSS------RGTSHLFAIN 499 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~------DgTVhVWdi~ 499 (921)
.. ..+.+++|||||++|++++. |+.++||++.
T Consensus 142 ~~----~~~t~~~WsPdGr~~~ta~t~~r~~~dng~~Iw~~~ 179 (194)
T PF08662_consen 142 EH----SDATDVEWSPDGRYLATATTSPRLRVDNGFKIWSFQ 179 (194)
T ss_pred cc----CcEEEEEEcCCCCEEEEEEeccceeccccEEEEEec
Confidence 32 23789999999999999875 7889999984
No 182
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=98.68 E-value=1.2e-07 Score=105.12 Aligned_cols=114 Identities=12% Similarity=0.212 Sum_probs=93.4
Q ss_pred ccccCCCCEEEEEECCCC-------ceEEEeccCCCCeEEEEECCCC-CEEEEEecCCCEEEEEeCCCCCCCCCCccCCC
Q 002446 383 FPDADNVGMVIVRDIVSK-------NVIAQFRAHKSPISALCFDPSG-ILLVTASVQGHNINIFKIIPGILGTSSACDAG 454 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~-------~~l~~~~aH~~pIsaLaFSPdG-tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~ 454 (921)
++++..|.+|.||++-.+ +++..|.+|...|.-++|.|.. ..|+|++.|.+ |.||++.++
T Consensus 97 IASgSeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~-v~iWnv~tg----------- 164 (472)
T KOG0303|consen 97 IASGSEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNT-VSIWNVGTG----------- 164 (472)
T ss_pred eecCCCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCce-EEEEeccCC-----------
Confidence 467788999999998643 5688999999999999999974 58999999965 999999997
Q ss_pred CceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCc
Q 002446 455 TSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANF 514 (921)
Q Consensus 455 ~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~ 514 (921)
..+.++. +.-.|++++|+.||.+|++++.|..|+|||..+..-...-.+|.+.-
T Consensus 165 ---eali~l~---hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~~v~e~~~heG~k 218 (472)
T KOG0303|consen 165 ---EALITLD---HPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGTVVSEGVAHEGAK 218 (472)
T ss_pred ---ceeeecC---CCCeEEEEEeccCCceeeeecccceeEEEcCCCCcEeeecccccCCC
Confidence 3455664 34569999999999999999999999999998864444446776653
No 183
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=98.67 E-value=1.7e-07 Score=105.30 Aligned_cols=118 Identities=15% Similarity=0.276 Sum_probs=95.5
Q ss_pred CcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 381 GHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 381 g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
..+++++.|.+|++||+.++++..++..|...|.+|+|.|. .++|+++|.||+ ++++|.... ..+ ..
T Consensus 257 nVLaSgsaD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~-V~l~D~R~~--~~s---------~~ 324 (463)
T KOG0270|consen 257 NVLASGSADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGT-VALKDCRDP--SNS---------GK 324 (463)
T ss_pred eeEEecCCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccce-EEeeeccCc--ccc---------Cc
Confidence 34567888999999999999999999999999999999995 889999999998 899999852 110 12
Q ss_pred EEEEecccccccEEEEEEccCCCE-EEEEeCCCcEEEEecCCCCCce-eecCCCCCcc
Q 002446 460 LYRLQRGLTNAVIQDISFSDDSNW-IMISSSRGTSHLFAINPLGGSV-NFQPTDANFT 515 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg~~-LAsgS~DgTVhVWdi~~~g~~~-~l~~H~~~~~ 515 (921)
.+++ .+.|-.++|.|.+.. +.+++.||++|=||+...+..+ ++++|.+.+.
T Consensus 325 ~wk~-----~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~~~vwt~~AHd~~IS 377 (463)
T KOG0270|consen 325 EWKF-----DGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPGKPVWTLKAHDDEIS 377 (463)
T ss_pred eEEe-----ccceEEEEecCCCceeEEEecCCceEEeeecCCCCCceeEEEeccCCcc
Confidence 3444 245999999987764 5678899999999999876554 7799977665
No 184
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.67 E-value=6.7e-08 Score=118.12 Aligned_cols=102 Identities=18% Similarity=0.237 Sum_probs=79.0
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCC--CeEEEEECCCC-CEEEEEecCCC--EEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKS--PISALCFDPSG-ILLVTASVQGH--NINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~--pIsaLaFSPdG-tlLATaS~DGt--~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
++...|.+.|||++.++++-.|..|.. .++.|+|+||+ +.|++|+.|.+ +|.+||+.-. + ..
T Consensus 179 S~s~sg~~~iWDlr~~~pii~ls~~~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~a---s----------sP 245 (1049)
T KOG0307|consen 179 SGSPSGRAVIWDLRKKKPIIKLSDTPGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFA---S----------SP 245 (1049)
T ss_pred ccCCCCCceeccccCCCcccccccCCCccceeeeeeCCCCceeeeeecCCCCCceeEeeccccc---C----------Cc
Confidence 445668899999999999888887765 47889999985 56888877754 6999998753 1 11
Q ss_pred EEEEecccccccEEEEEEccCC-CEEEEEeCCCcEEEEecCCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDS-NWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg-~~LAsgS~DgTVhVWdi~~~ 501 (921)
+..+ ++|..+ |.+++|++.+ ++|++++.|+.|.+|+.+++
T Consensus 246 ~k~~-~~H~~G-ilslsWc~~D~~lllSsgkD~~ii~wN~~tg 286 (1049)
T KOG0307|consen 246 LKIL-EGHQRG-ILSLSWCPQDPRLLLSSGKDNRIICWNPNTG 286 (1049)
T ss_pred hhhh-cccccc-eeeeccCCCCchhhhcccCCCCeeEecCCCc
Confidence 2233 455443 9999999855 99999999999999999884
No 185
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.67 E-value=1.1e-06 Score=94.42 Aligned_cols=100 Identities=17% Similarity=0.250 Sum_probs=80.7
Q ss_pred CCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 387 DNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
..++++..||+.+.+....++ +|...|..|.|+|+-+ +||||++||. |||||+... ...+.++
T Consensus 190 t~d~tl~~~D~RT~~~~~sI~dAHgq~vrdlDfNpnkq~~lvt~gDdgy-vriWD~R~t-------------k~pv~el- 254 (370)
T KOG1007|consen 190 TSDSTLQFWDLRTMKKNNSIEDAHGQRVRDLDFNPNKQHILVTCGDDGY-VRIWDTRKT-------------KFPVQEL- 254 (370)
T ss_pred eCCCcEEEEEccchhhhcchhhhhcceeeeccCCCCceEEEEEcCCCcc-EEEEeccCC-------------Ccccccc-
Confidence 457899999999988777776 9999999999999865 6999999997 999999864 1234455
Q ss_pred cccccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCCC
Q 002446 465 RGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 465 RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~g 502 (921)
.+|. +.|+++-|.| -.+.|.+|++|..|-+|-...-.
T Consensus 255 ~~Hs-HWvW~VRfn~~hdqLiLs~~SDs~V~Lsca~svS 292 (370)
T KOG1007|consen 255 PGHS-HWVWAVRFNPEHDQLILSGGSDSAVNLSCASSVS 292 (370)
T ss_pred CCCc-eEEEEEEecCccceEEEecCCCceeEEEeccccc
Confidence 3544 4599999998 46788899999999999876543
No 186
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.66 E-value=1.4e-06 Score=93.95 Aligned_cols=89 Identities=19% Similarity=0.347 Sum_probs=66.4
Q ss_pred CEEEEEECCCC-ceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSK-NVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|.|.|+... .+++.++.|.+.|..++|.| +...|+||++|- .+-|||+..-.... .. .....|+.
T Consensus 266 ~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS~~hictaGDD~-qaliWDl~q~~~~~--~~----dPilay~a---- 334 (364)
T KOG0290|consen 266 NKVVILDIRVPCTPVARLRNHQASVNGIAWAPHSSSHICTAGDDC-QALIWDLQQMPREN--GE----DPILAYTA---- 334 (364)
T ss_pred ceEEEEEecCCCcceehhhcCcccccceEecCCCCceeeecCCcc-eEEEEecccccccC--CC----Cchhhhhc----
Confidence 57899999864 68899999999999999999 577999999995 58999998741100 00 11122332
Q ss_pred ccccEEEEEEcc-CCCEEEEEeCC
Q 002446 468 TNAVIQDISFSD-DSNWIMISSSR 490 (921)
Q Consensus 468 t~a~I~sIaFSP-Dg~~LAsgS~D 490 (921)
.+.|..|.|++ .+.|||++...
T Consensus 335 -~~EVNqi~Ws~~~~Dwiai~~~k 357 (364)
T KOG0290|consen 335 -GGEVNQIQWSSSQPDWIAICFGK 357 (364)
T ss_pred -cceeeeeeecccCCCEEEEEecC
Confidence 23599999984 78999998754
No 187
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.65 E-value=1.2e-05 Score=93.33 Aligned_cols=72 Identities=22% Similarity=0.329 Sum_probs=47.2
Q ss_pred eEEEEECCCCCEEEEEecCCC--EEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 413 ISALCFDPSGILLVTASVQGH--NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 413 IsaLaFSPdGtlLATaS~DGt--~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
....+|||||++||.++.++. .|.+||+.++ ... .+..+ ......+|+|||++|+.++.+
T Consensus 330 ~~~~~~SpDG~~Ia~~s~~~g~~~I~v~d~~~g------------~~~---~lt~~---~~~~~p~~spdg~~l~~~~~~ 391 (427)
T PRK02889 330 NTSPRISPDGKLLAYISRVGGAFKLYVQDLATG------------QVT---ALTDT---TRDESPSFAPNGRYILYATQQ 391 (427)
T ss_pred cCceEECCCCCEEEEEEccCCcEEEEEEECCCC------------CeE---EccCC---CCccCceECCCCCEEEEEEec
Confidence 345789999999998876642 4889998765 111 22222 124678999999999988765
Q ss_pred C-cEEEEecCCCC
Q 002446 491 G-TSHLFAINPLG 502 (921)
Q Consensus 491 g-TVhVWdi~~~g 502 (921)
+ .-.++-+...+
T Consensus 392 ~g~~~l~~~~~~g 404 (427)
T PRK02889 392 GGRSVLAAVSSDG 404 (427)
T ss_pred CCCEEEEEEECCC
Confidence 4 33455444333
No 188
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=98.65 E-value=8.3e-07 Score=100.69 Aligned_cols=107 Identities=14% Similarity=0.225 Sum_probs=83.6
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+.+++..|.|+|||+..+.+...++.|++.|++|.++-...+||+.+.-|. |.|..+.++. ..-+
T Consensus 94 ~~sgG~~~~Vkiwdl~~kl~hr~lkdh~stvt~v~YN~~DeyiAsvs~gGd-iiih~~~t~~--------------~tt~ 158 (673)
T KOG4378|consen 94 EISGGQSGCVKIWDLRAKLIHRFLKDHQSTVTYVDYNNTDEYIASVSDGGD-IIIHGTKTKQ--------------KTTT 158 (673)
T ss_pred eeccCcCceeeehhhHHHHHhhhccCCcceeEEEEecCCcceeEEeccCCc-EEEEecccCc--------------cccc
Confidence 345677899999999988888899999999999999999999999999887 7898888761 1112
Q ss_pred EecccccccEEEEEEccCCCEE-EEEeCCCcEEEEecCCCCCce
Q 002446 463 LQRGLTNAVIQDISFSDDSNWI-MISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~L-AsgS~DgTVhVWdi~~~g~~~ 505 (921)
|.-+. ...|.-+.|||-.+++ .++|++|+|+|||+.......
T Consensus 159 f~~~s-gqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~sp~~ 201 (673)
T KOG4378|consen 159 FTIDS-GQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGMSPIF 201 (673)
T ss_pred eecCC-CCeEEEeecccccceeeEeeccCCeEEEEeccCCCccc
Confidence 22121 1236688999988875 578999999999997654433
No 189
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=98.63 E-value=1e-06 Score=105.70 Aligned_cols=104 Identities=13% Similarity=0.175 Sum_probs=77.0
Q ss_pred CCCEEEEEECCCCceEE----EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 388 NVGMVIVRDIVSKNVIA----QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~----~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
....+.+|+..++.... .-+-|+.+++|.+|||.++++|++..||+ |.||.-... .+ .......+
T Consensus 179 ~~~~~~~~~v~~~~~~~~~~~~~~~Htf~~t~~~~spn~~~~Aa~d~dGr-I~vw~d~~~-~~---------~~~t~t~l 247 (792)
T KOG1963|consen 179 HMCKIHIYFVPKHTKHTSSRDITVHHTFNITCVALSPNERYLAAGDSDGR-ILVWRDFGS-SD---------DSETCTLL 247 (792)
T ss_pred EeeeEEEEEecccceeeccchhhhhhcccceeEEeccccceEEEeccCCc-EEEEecccc-cc---------ccccceEE
Confidence 34567888887754111 11267888999999999999999999998 899964431 00 01112345
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
++.+ +.|.+++||+||.+|.+|+..+.+-+|.+.+.+..
T Consensus 248 HWH~--~~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~kq 286 (792)
T KOG1963|consen 248 HWHH--DEVNSLSFSSDGAYLLSGGREGVLVLWQLETGKKQ 286 (792)
T ss_pred Eecc--cccceeEEecCCceEeecccceEEEEEeecCCCcc
Confidence 5543 46999999999999999999999999999987643
No 190
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.59 E-value=3e-05 Score=84.78 Aligned_cols=108 Identities=19% Similarity=0.269 Sum_probs=72.0
Q ss_pred EEEEEECCCCceEEEeccC--CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCC---CCccCC-------CCcee
Q 002446 391 MVIVRDIVSKNVIAQFRAH--KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGT---SSACDA-------GTSYV 458 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH--~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~---~s~~~~-------~~~~~ 458 (921)
.|+|||..+|+.+..|+.- ...|.||+||||+.+||.+|++|| ++||.+....... ++.... .++.+
T Consensus 205 LIRIFdt~~g~~l~E~RRG~d~A~iy~iaFSp~~s~LavsSdKgT-lHiF~l~~~~~~~~~~SSl~~~~~~lpky~~S~w 283 (346)
T KOG2111|consen 205 LIRIFDTEDGTLLQELRRGVDRADIYCIAFSPNSSWLAVSSDKGT-LHIFSLRDTENTEDESSSLSFKRLVLPKYFSSEW 283 (346)
T ss_pred EEEEEEcCCCcEeeeeecCCchheEEEEEeCCCccEEEEEcCCCe-EEEEEeecCCCCccccccccccccccchhcccce
Confidence 4899999999999999833 357999999999999999999998 8999998743211 111100 01112
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
-+.+++- ......-++|-.+.+-++....||+-+=+.+.+.
T Consensus 284 S~~~f~l--~~~~~~~~~fg~~~nsvi~i~~Dgsy~k~~f~~~ 324 (346)
T KOG2111|consen 284 SFAKFQL--PQGTQCIIAFGSETNTVIAICADGSYYKFKFDPK 324 (346)
T ss_pred eEEEEEc--cCCCcEEEEecCCCCeEEEEEeCCcEEEEEeccc
Confidence 2222211 1122456788888666666677898766555543
No 191
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.59 E-value=3.7e-07 Score=105.57 Aligned_cols=91 Identities=14% Similarity=0.263 Sum_probs=71.1
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+.+.++-+|+|||+.+.+....|.+|+..|-.++|||||+++||.+.||+ |+||+-...+ ..+|+-
T Consensus 694 a~asyd~Ti~lWDl~~~~~~~~l~gHtdqIf~~AWSpdGr~~AtVcKDg~-~rVy~Prs~e-------------~pv~Eg 759 (1012)
T KOG1445|consen 694 AVASYDSTIELWDLANAKLYSRLVGHTDQIFGIAWSPDGRRIATVCKDGT-LRVYEPRSRE-------------QPVYEG 759 (1012)
T ss_pred hhhhccceeeeeehhhhhhhheeccCcCceeEEEECCCCcceeeeecCce-EEEeCCCCCC-------------CccccC
Confidence 34567789999999999999999999999999999999999999999998 8999876541 112221
Q ss_pred e--cccccccEEEEEEccCCCEEEEEeCCC
Q 002446 464 Q--RGLTNAVIQDISFSDDSNWIMISSSRG 491 (921)
Q Consensus 464 ~--RG~t~a~I~sIaFSPDg~~LAsgS~Dg 491 (921)
. -|...| -|.|.-||+++.+.+.|.
T Consensus 760 ~gpvgtRgA---Ri~wacdgr~viv~Gfdk 786 (1012)
T KOG1445|consen 760 KGPVGTRGA---RILWACDGRIVIVVGFDK 786 (1012)
T ss_pred CCCccCcce---eEEEEecCcEEEEecccc
Confidence 0 122223 466888999999888764
No 192
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=98.57 E-value=1.2e-06 Score=106.38 Aligned_cols=108 Identities=13% Similarity=0.156 Sum_probs=75.8
Q ss_pred cccccCCCCEEEEEECCCCceE--EEeccCC--C-CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCc
Q 002446 382 HFPDADNVGMVIVRDIVSKNVI--AQFRAHK--S-PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTS 456 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l--~~~~aH~--~-pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~ 456 (921)
.++++..+|.|++||+...... -++..|. + ..++|...++..++|+|+. + .|+||++.-..-..
T Consensus 1271 elvSgs~~G~I~~~DlR~~~~e~~~~iv~~~~yGs~lTal~VH~hapiiAsGs~-q-~ikIy~~~G~~l~~--------- 1339 (1387)
T KOG1517|consen 1271 ELVSGSQDGDIQLLDLRMSSKETFLTIVAHWEYGSALTALTVHEHAPIIASGSA-Q-LIKIYSLSGEQLNI--------- 1339 (1387)
T ss_pred ceeeeccCCeEEEEecccCcccccceeeeccccCccceeeeeccCCCeeeecCc-c-eEEEEecChhhhcc---------
Confidence 3456678899999999874322 2333554 3 5999999999999999998 4 49999987530000
Q ss_pred eeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 457 YVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 457 ~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
..-+...-|.....+.|++|.|---.+|+|+.|.+|-||...+.
T Consensus 1340 -~k~n~~F~~q~~gs~scL~FHP~~~llAaG~~Ds~V~iYs~~k~ 1383 (1387)
T KOG1517|consen 1340 -IKYNPGFMGQRIGSVSCLAFHPHRLLLAAGSADSTVSIYSCEKP 1383 (1387)
T ss_pred -cccCcccccCcCCCcceeeecchhHhhhhccCCceEEEeecCCc
Confidence 00001011222223789999999999999999999999987765
No 193
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=98.57 E-value=0.00016 Score=81.55 Aligned_cols=85 Identities=18% Similarity=0.394 Sum_probs=60.0
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe-CC
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS-SR 490 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS-~D 490 (921)
....|+++|||++|..+......|-+|++... . +....+..+.-+ ......++|+|||+||+++. .+
T Consensus 246 ~~~~i~ispdg~~lyvsnr~~~sI~vf~~d~~-~---------g~l~~~~~~~~~--G~~Pr~~~~s~~g~~l~Va~~~s 313 (345)
T PF10282_consen 246 APAEIAISPDGRFLYVSNRGSNSISVFDLDPA-T---------GTLTLVQTVPTG--GKFPRHFAFSPDGRYLYVANQDS 313 (345)
T ss_dssp SEEEEEE-TTSSEEEEEECTTTEEEEEEECTT-T---------TTEEEEEEEEES--SSSEEEEEE-TTSSEEEEEETTT
T ss_pred CceeEEEecCCCEEEEEeccCCEEEEEEEecC-C---------CceEEEEEEeCC--CCCccEEEEeCCCCEEEEEecCC
Confidence 57889999999999988877777999999542 1 123333333321 12278999999999999887 56
Q ss_pred CcEEEEecCCCCCceeec
Q 002446 491 GTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 491 gTVhVWdi~~~g~~~~l~ 508 (921)
++|.+|+++...+.....
T Consensus 314 ~~v~vf~~d~~tG~l~~~ 331 (345)
T PF10282_consen 314 NTVSVFDIDPDTGKLTPV 331 (345)
T ss_dssp TEEEEEEEETTTTEEEEE
T ss_pred CeEEEEEEeCCCCcEEEe
Confidence 799999998766665543
No 194
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=98.55 E-value=1.7e-05 Score=88.83 Aligned_cols=304 Identities=20% Similarity=0.305 Sum_probs=164.8
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCC--------eEEeeeeecCCEEEEEEecCCCCCccccCc
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADN--------VHDLVSRYDGPVSFMQMLPRPITSKRSRDK 158 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~--------~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~ 158 (921)
.++.|.-+.|.+ ... ..+...|.++.++||-++.... ..-.+++|++.|.++++.|+
T Consensus 12 ~~~pv~s~dfq~---n~~--~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~---------- 76 (434)
T KOG1009|consen 12 DHEPVYSVDFQK---NSL--NKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPD---------- 76 (434)
T ss_pred CCCceEEEEecc---Ccc--cceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCC----------
Confidence 467788888888 321 1555666688899999976421 12235789999999999874
Q ss_pred cccCCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECC--------C-----C---cEEEEE
Q 002446 159 FAEVRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLR--------S-----Q---SYVHML 222 (921)
Q Consensus 159 F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~--------T-----g---~~V~tL 222 (921)
..+||.++++ +.|.+|-.. + . ...+.+
T Consensus 77 ----gelLASg~D~---------------------------------g~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~l 119 (434)
T KOG1009|consen 77 ----GELLASGGDG---------------------------------GEVFLWKQGDVRIFDADTEADLNKEKWVVKKVL 119 (434)
T ss_pred ----cCeeeecCCC---------------------------------ceEEEEEecCcCCccccchhhhCccceEEEEEe
Confidence 2578777653 234444332 3 1 122333
Q ss_pred e-CCCCEEEEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecC--ceEEecCCCc
Q 002446 223 K-FRSPIYSVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGP--RWLAYSGSPV 296 (921)
Q Consensus 223 ~-f~s~V~sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgp--RwLAyas~~~ 296 (921)
. +...||.++++ .+++++ +.++.+++||+..++.+..+..|.... .-+|..| +++|.-+.
T Consensus 120 r~h~~diydL~Ws~d~~~l~s~s~dns~~l~Dv~~G~l~~~~~dh~~yv------------qgvawDpl~qyv~s~s~-- 185 (434)
T KOG1009|consen 120 RGHRDDIYDLAWSPDSNFLVSGSVDNSVRLWDVHAGQLLAILDDHEHYV------------QGVAWDPLNQYVASKSS-- 185 (434)
T ss_pred cccccchhhhhccCCCceeeeeeccceEEEEEeccceeEeecccccccc------------ceeecchhhhhhhhhcc--
Confidence 3 35799999997 356655 889999999999999998888775421 1133322 33332211
Q ss_pred eecCCCccCCcccccccccccccCCCcceeehhhhc--chhhc----ceeEecCCccccccccccc--cccCCCcCCccc
Q 002446 297 VVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKES--SKHLA----AGIVNLGDLGYKKLSQYCS--EFLPDSQNSLQS 368 (921)
Q Consensus 297 ~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~--sK~La----sGl~~lGd~g~k~ls~y~~--~~~p~~~~si~s 368 (921)
.| .|....- .--..+..++... ++.-. .-++.+.|...+ .++. .++|++. ..
T Consensus 186 -----dr-~~~~~~~--------~~~~~~~~~~~~~m~~~~~~~~e~~s~rLfhDeTlk---sFFrRlsfTPdG~--ll- 245 (434)
T KOG1009|consen 186 -----DR-HPEGFSA--------KLKQVIKRHGLDIMPAKAFNEREGKSTRLFHDETLK---SFFRRLSFTPDGS--LL- 245 (434)
T ss_pred -----Cc-ccceeee--------eeeeeeeeeeeeEeeecccCCCCcceeeeeecCchh---hhhhhcccCCCCc--EE-
Confidence 11 0000000 0000000111000 00000 001111111111 1111 1223331 10
Q ss_pred ccCCCCCCCcccCcccccC--CCCEEEEEECC-CCceEEEeccCCCCeEEEEECC------------------CCCEEEE
Q 002446 369 AIPGGKSNGTVNGHFPDAD--NVGMVIVRDIV-SKNVIAQFRAHKSPISALCFDP------------------SGILLVT 427 (921)
Q Consensus 369 a~~~~k~~g~v~g~~~s~~--~~G~V~IwDl~-s~~~l~~~~aH~~pIsaLaFSP------------------dGtlLAT 427 (921)
..|. +.+-.++ ...+.++|+-. ..++++.+..-..+..++.|+| -+..+|.
T Consensus 246 vtPa--------g~~~~g~~~~~n~tYvfsrk~l~rP~~~lp~~~k~~lavr~~pVy~elrp~~~~~~~~~lpyrlvfai 317 (434)
T KOG1009|consen 246 VTPA--------GLFKVGGGVFRNTSYVFSRKDLKRPAARLPSPKKPALAVRFSPVYYELRPLSSEKFLFVLPYRLVFAI 317 (434)
T ss_pred Eccc--------ceeeeCCceeeceeEeeccccccCceeecCCCCcceEEEEeeeeEEEeccccccccccccccceEEEE
Confidence 0110 0000000 02334555433 2467778887778888888765 2345677
Q ss_pred EecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 428 ASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 428 aS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|..+ .+.|||..+- ..++.+. +.+-+.|++||||+||..|+++|.||-+-+--+.+.
T Consensus 318 At~~--svyvydtq~~--------------~P~~~v~-nihy~~iTDiaws~dg~~l~vSS~DGyCS~vtfe~~ 374 (434)
T KOG1009|consen 318 ATKN--SVYVYDTQTL--------------EPLAVVD-NIHYSAITDIAWSDDGSVLLVSSTDGFCSLVTFEPW 374 (434)
T ss_pred eecc--eEEEeccccc--------------cceEEEe-eeeeeeecceeecCCCcEEEEeccCCceEEEEEcch
Confidence 7776 4899998863 2233332 334456999999999999999999998877666553
No 195
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.54 E-value=1.9e-06 Score=92.88 Aligned_cols=107 Identities=16% Similarity=0.239 Sum_probs=81.9
Q ss_pred cccccCCCCEEEEEECCCCceEEEec---cCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFR---AHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~---aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
.|++.+.||.|+++|+....--..+- ....|...|++++ |-.+|||-..|...|.|-|+... +
T Consensus 211 ~FASvgaDGSvRmFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P-------------~ 277 (364)
T KOG0290|consen 211 VFASVGADGSVRMFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVP-------------C 277 (364)
T ss_pred eEEEecCCCcEEEEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCC-------------C
Confidence 45566789999999998875433333 2246888899998 56789998888888999999874 2
Q ss_pred eEEEEEecccccccEEEEEEccC-CCEEEEEeCCCcEEEEecCCCCC
Q 002446 458 VHLYRLQRGLTNAVIQDISFSDD-SNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sIaFSPD-g~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
..+.+| |+| .+.|+.|+|.|. +..|+++++|.-+-|||+.....
T Consensus 278 tpva~L-~~H-~a~VNgIaWaPhS~~hictaGDD~qaliWDl~q~~~ 322 (364)
T KOG0290|consen 278 TPVARL-RNH-QASVNGIAWAPHSSSHICTAGDDCQALIWDLQQMPR 322 (364)
T ss_pred cceehh-hcC-cccccceEecCCCCceeeecCCcceEEEEecccccc
Confidence 345566 454 467999999996 46899999999999999986533
No 196
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.54 E-value=9.3e-07 Score=98.99 Aligned_cols=75 Identities=19% Similarity=0.301 Sum_probs=63.1
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
...|++|+.|+||+++|-++.||. |-|+++..- +.++-.++-|- ..|+.|.|+||.+++++.|.
T Consensus 281 ~~siSsl~VS~dGkf~AlGT~dGs-Vai~~~~~l--------------q~~~~vk~aH~-~~VT~ltF~Pdsr~~~svSs 344 (398)
T KOG0771|consen 281 FKSISSLAVSDDGKFLALGTMDGS-VAIYDAKSL--------------QRLQYVKEAHL-GFVTGLTFSPDSRYLASVSS 344 (398)
T ss_pred cCcceeEEEcCCCcEEEEeccCCc-EEEEEecee--------------eeeEeehhhhe-eeeeeEEEcCCcCccccccc
Confidence 358999999999999999999996 899998763 44555555443 35999999999999999999
Q ss_pred CCcEEEEecCC
Q 002446 490 RGTSHLFAINP 500 (921)
Q Consensus 490 DgTVhVWdi~~ 500 (921)
|.+++|..+.-
T Consensus 345 ~~~~~v~~l~v 355 (398)
T KOG0771|consen 345 DNEAAVTKLAV 355 (398)
T ss_pred CCceeEEEEee
Confidence 99999998854
No 197
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.54 E-value=3e-07 Score=102.88 Aligned_cols=131 Identities=17% Similarity=0.250 Sum_probs=93.1
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC--CCC--C--------
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL--GTS--S-------- 449 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~--~~~--s-------- 449 (921)
.+++++.||++|||+..+...+..+.+|...|.+|.|||||++||+-+.|+ .+||++.++.+ ..+ +
T Consensus 158 ~latgg~dg~lRv~~~Ps~~t~l~e~~~~~eV~DL~FS~dgk~lasig~d~--~~VW~~~~g~~~a~~t~~~k~~~~~~c 235 (398)
T KOG0771|consen 158 KLATGGTDGTLRVWEWPSMLTILEEIAHHAEVKDLDFSPDGKFLASIGADS--ARVWSVNTGAALARKTPFSKDEMFSSC 235 (398)
T ss_pred EeeeccccceEEEEecCcchhhhhhHhhcCccccceeCCCCcEEEEecCCc--eEEEEeccCchhhhcCCcccchhhhhc
Confidence 456778899999999998888889999999999999999999999999993 79999998721 000 0
Q ss_pred ---ccC------------CCCceeE-EEEEecc---------c-ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCC
Q 002446 450 ---ACD------------AGTSYVH-LYRLQRG---------L-TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 450 ---~~~------------~~~~~~~-l~~l~RG---------~-t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
..+ +...... -..+.++ . ....|.+++.|+||+++|.|+.||.|-|++..+-..
T Consensus 236 RF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT~dGsVai~~~~~lq~ 315 (398)
T KOG0771|consen 236 RFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGTMDGSVAIYDAKSLQR 315 (398)
T ss_pred eecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEeccCCcEEEEEeceeee
Confidence 000 0000000 0011112 0 011389999999999999999999999999987644
Q ss_pred ceee-cCCCCCc
Q 002446 504 SVNF-QPTDANF 514 (921)
Q Consensus 504 ~~~l-~~H~~~~ 514 (921)
..-+ +.|..-+
T Consensus 316 ~~~vk~aH~~~V 327 (398)
T KOG0771|consen 316 LQYVKEAHLGFV 327 (398)
T ss_pred eEeehhhheeee
Confidence 4333 6675433
No 198
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.54 E-value=2.2e-07 Score=106.78 Aligned_cols=114 Identities=20% Similarity=0.300 Sum_probs=88.8
Q ss_pred CcccccCCCCEEEEEECCC--------CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccC
Q 002446 381 GHFPDADNVGMVIVRDIVS--------KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACD 452 (921)
Q Consensus 381 g~~~s~~~~G~V~IwDl~s--------~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~ 452 (921)
++++++..+|++++|.++. -+++.+|++|.+||-|++.+++|..+.||+.||+ |+.|++.+. ..+....+
T Consensus 307 p~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfraH~gPVl~v~v~~n~~~~ysgg~Dg~-I~~w~~p~n-~dp~ds~d 384 (577)
T KOG0642|consen 307 PVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRAHEGPVLCVVVPSNGEHCYSGGIDGT-IRCWNLPPN-QDPDDSYD 384 (577)
T ss_pred CeEEEeccccchhhhhhcccCCccccceeeeEEEecccCceEEEEecCCceEEEeeccCce-eeeeccCCC-CCcccccC
Confidence 3567788999999999932 2578899999999999999999999999999998 999988743 11111111
Q ss_pred CCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 453 AGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 453 ~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
+ .-+....-||+.+ |+.+++|+...+|+++|.|||+++|.....
T Consensus 385 p----~vl~~~l~Ghtda-vw~l~~s~~~~~Llscs~DgTvr~w~~~~~ 428 (577)
T KOG0642|consen 385 P----SVLSGTLLGHTDA-VWLLALSSTKDRLLSCSSDGTVRLWEPTEE 428 (577)
T ss_pred c----chhccceeccccc-eeeeeecccccceeeecCCceEEeeccCCc
Confidence 1 1112223588766 999999999999999999999999987543
No 199
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.51 E-value=1.5e-07 Score=107.63 Aligned_cols=95 Identities=18% Similarity=0.303 Sum_probs=69.8
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
.++..+.--.++|...+|||||++||+.|.||. +||||..+. +|.-+-+-+- +-..|++||||
T Consensus 281 NPv~~w~~~~g~in~f~FS~DG~~LA~VSqDGf-LRvF~fdt~---------------eLlg~mkSYF-GGLLCvcWSPD 343 (636)
T KOG2394|consen 281 NPVARWHIGEGSINEFAFSPDGKYLATVSQDGF-LRIFDFDTQ---------------ELLGVMKSYF-GGLLCVCWSPD 343 (636)
T ss_pred CccceeEeccccccceeEcCCCceEEEEecCce-EEEeeccHH---------------HHHHHHHhhc-cceEEEEEcCC
Confidence 455555444568999999999999999999997 899998874 1111111111 12789999999
Q ss_pred CCEEEEEeCCCcEEEEecCCCCCceeecCCCC
Q 002446 481 SNWIMISSSRGTSHLFAINPLGGSVNFQPTDA 512 (921)
Q Consensus 481 g~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~ 512 (921)
|+||++|+.|.-|-||.+....-...=++|.+
T Consensus 344 GKyIvtGGEDDLVtVwSf~erRVVARGqGHkS 375 (636)
T KOG2394|consen 344 GKYIVTGGEDDLVTVWSFEERRVVARGQGHKS 375 (636)
T ss_pred ccEEEecCCcceEEEEEeccceEEEecccccc
Confidence 99999999999999999977533333366643
No 200
>PRK01742 tolB translocation protein TolB; Provisional
Probab=98.49 E-value=4.3e-06 Score=96.94 Aligned_cols=90 Identities=10% Similarity=0.124 Sum_probs=61.6
Q ss_pred EEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEec-CCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 392 VIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASV-QGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 392 V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~-DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
|.+||+.+++. ..+..|...+.+.+|+|||+.|+.++. +|. .+||++... . .. .. .+ +.. .
T Consensus 274 Iy~~d~~~~~~-~~lt~~~~~~~~~~wSpDG~~i~f~s~~~g~-~~I~~~~~~-~---------~~-~~--~l--~~~-~ 335 (429)
T PRK01742 274 IYVMGANGGTP-SQLTSGAGNNTEPSWSPDGQSILFTSDRSGS-PQVYRMSAS-G---------GG-AS--LV--GGR-G 335 (429)
T ss_pred EEEEECCCCCe-EeeccCCCCcCCEEECCCCCEEEEEECCCCC-ceEEEEECC-C---------CC-eE--Ee--cCC-C
Confidence 56667776654 556677778889999999998876664 565 799987653 0 01 11 11 111 1
Q ss_pred cEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 471 VIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
.+++|||||++|+.++.++ +.+||+.++.
T Consensus 336 --~~~~~SpDG~~ia~~~~~~-i~~~Dl~~g~ 364 (429)
T PRK01742 336 --YSAQISADGKTLVMINGDN-VVKQDLTSGS 364 (429)
T ss_pred --CCccCCCCCCEEEEEcCCC-EEEEECCCCC
Confidence 3578999999999988866 5558987643
No 201
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.45 E-value=1.1e-06 Score=100.72 Aligned_cols=61 Identities=11% Similarity=0.324 Sum_probs=55.5
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
+++....||.++|+|+.+.+++..++..-+...|++|||||+|+||+++|- .+.||.....
T Consensus 304 ~LA~VSqDGfLRvF~fdt~eLlg~mkSYFGGLLCvcWSPDGKyIvtGGEDD-LVtVwSf~er 364 (636)
T KOG2394|consen 304 YLATVSQDGFLRIFDFDTQELLGVMKSYFGGLLCVCWSPDGKYIVTGGEDD-LVTVWSFEER 364 (636)
T ss_pred eEEEEecCceEEEeeccHHHHHHHHHhhccceEEEEEcCCccEEEecCCcc-eEEEEEeccc
Confidence 556678899999999999999999998889999999999999999999995 7999998864
No 202
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=98.42 E-value=0.00043 Score=78.66 Aligned_cols=101 Identities=15% Similarity=0.173 Sum_probs=70.1
Q ss_pred CEEEEEECCC-----CceEEEecc-------CCCCeEEEEECCCCCEEEEEec---------CCCEEEEEeCCCCCCCCC
Q 002446 390 GMVIVRDIVS-----KNVIAQFRA-------HKSPISALCFDPSGILLVTASV---------QGHNINIFKIIPGILGTS 448 (921)
Q Consensus 390 G~V~IwDl~s-----~~~l~~~~a-------H~~pIsaLaFSPdGtlLATaS~---------DGt~IrIWdi~~g~~~~~ 448 (921)
|+|.+.|+.. .+.+..+.. ..+.+.-++|+|||+.|..+.. -++.|-++|+.++
T Consensus 215 G~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~----- 289 (352)
T TIGR02658 215 GKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAKTG----- 289 (352)
T ss_pred CeEEEEecCCCcceecceeeeccccccccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECCCC-----
Confidence 9999999644 333333321 2234445999999998887542 1245888888875
Q ss_pred CccCCCCceeEEEEEecccccccEEEEEEccCCC-EEEEEe-CCCcEEEEecCCCCCceee
Q 002446 449 SACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSN-WIMISS-SRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 449 s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~-~LAsgS-~DgTVhVWdi~~~g~~~~l 507 (921)
+.+.++.-| ..+..|+||||++ +|.+.. .+++|.|+|+.+......+
T Consensus 290 ---------kvi~~i~vG---~~~~~iavS~Dgkp~lyvtn~~s~~VsViD~~t~k~i~~i 338 (352)
T TIGR02658 290 ---------KRLRKIELG---HEIDSINVSQDAKPLLYALSTGDKTLYIFDAETGKELSSV 338 (352)
T ss_pred ---------eEEEEEeCC---CceeeEEECCCCCeEEEEeCCCCCcEEEEECcCCeEEeee
Confidence 445555444 3588999999999 887776 5889999999887555554
No 203
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=98.41 E-value=9.4e-05 Score=84.43 Aligned_cols=85 Identities=18% Similarity=0.261 Sum_probs=56.7
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCC--EEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGH--NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt--~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.++|+.+++. ..+..+...+..++|+|||++|+.++.++. .|.+||+.++ ... .+..+
T Consensus 303 ~iy~~d~~~~~~-~~l~~~~~~~~~~~~spdg~~i~~~~~~~~~~~i~~~d~~~~------------~~~---~l~~~-- 364 (417)
T TIGR02800 303 QIYMMDADGGEV-RRLTFRGGYNASPSWSPDGDLIAFVHREGGGFNIAVMDLDGG------------GER---VLTDT-- 364 (417)
T ss_pred eEEEEECCCCCE-EEeecCCCCccCeEECCCCCEEEEEEccCCceEEEEEeCCCC------------CeE---EccCC--
Confidence 577788877654 344445566778899999999999887752 3677777653 111 12111
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEE
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSH 494 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVh 494 (921)
......+|+|||++|+.++.++...
T Consensus 365 -~~~~~p~~spdg~~l~~~~~~~~~~ 389 (417)
T TIGR02800 365 -GLDESPSFAPNGRMILYATTRGGRG 389 (417)
T ss_pred -CCCCCceECCCCCEEEEEEeCCCcE
Confidence 1234678999999999888876443
No 204
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.39 E-value=2.5e-05 Score=90.68 Aligned_cols=94 Identities=19% Similarity=0.232 Sum_probs=62.4
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEE--eCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIF--KIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIW--di~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|.+||+.+++. ..+..|.......+|+|||+.|+.++..+....|| |+..+ ....+ ++ .|
T Consensus 272 ~~Iy~~d~~~g~~-~~lt~~~~~~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~~g------------~~~~l-t~-~g- 335 (433)
T PRK04922 272 PEIYVMDLGSRQL-TRLTNHFGIDTEPTWAPDGKSIYFTSDRGGRPQIYRVAASGG------------SAERL-TF-QG- 335 (433)
T ss_pred ceEEEEECCCCCe-EECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCC------------CeEEe-ec-CC-
Confidence 4689999988865 45666666667899999999998877543224455 44433 11222 22 12
Q ss_pred ccccEEEEEEccCCCEEEEEeCCC---cEEEEecCCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRG---TSHLFAINPL 501 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~~~ 501 (921)
.....++|||||++||..+.++ .|.+|++.+.
T Consensus 336 --~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~~g 370 (433)
T PRK04922 336 --NYNARASVSPDGKKIAMVHGSGGQYRIAVMDLSTG 370 (433)
T ss_pred --CCccCEEECCCCCEEEEEECCCCceeEEEEECCCC
Confidence 1244689999999999876543 5888888653
No 205
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.38 E-value=5.2e-06 Score=95.15 Aligned_cols=81 Identities=15% Similarity=0.104 Sum_probs=62.1
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+++++.|-..+|||.. |+.+..-.+|..||++++|+|| +++|.+|.. + .|+ ...
T Consensus 201 I~sgGED~kfKvWD~~-G~~Lf~S~~~ey~ITSva~npd-~~~~v~S~n-t-~R~---~~p------------------- 254 (737)
T KOG1524|consen 201 IASGGEDFRFKIWDAQ-GANLFTSAAEEYAITSVAFNPE-KDYLLWSYN-T-ARF---SSP------------------- 254 (737)
T ss_pred eeecCCceeEEeeccc-CcccccCChhccceeeeeeccc-cceeeeeee-e-eee---cCC-------------------
Confidence 4566778899999976 4566677899999999999999 888887764 3 441 111
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEE
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSH 494 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVh 494 (921)
....|..++||+||..+++|+..|-+.
T Consensus 255 -----~~GSifnlsWS~DGTQ~a~gt~~G~v~ 281 (737)
T KOG1524|consen 255 -----RVGSIFNLSWSADGTQATCGTSTGQLI 281 (737)
T ss_pred -----CccceEEEEEcCCCceeeccccCceEE
Confidence 112388999999999999999888653
No 206
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=98.36 E-value=2.9e-05 Score=94.76 Aligned_cols=114 Identities=16% Similarity=0.203 Sum_probs=83.5
Q ss_pred ccccCCCCEEEEEECCCC---ceEEEeccCCCC--eEEEEECCCCCE-EEEEecCCCEEEEEeCCCCCCCCCCccCCCCc
Q 002446 383 FPDADNVGMVIVRDIVSK---NVIAQFRAHKSP--ISALCFDPSGIL-LVTASVQGHNINIFKIIPGILGTSSACDAGTS 456 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~---~~l~~~~aH~~p--IsaLaFSPdGtl-LATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~ 456 (921)
++.+-.||.|++||.... ..+...+.|+.. |..+.|.+.|-- |++||.+|. |++||+....... -
T Consensus 1224 i~AGfaDGsvRvyD~R~a~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~G~-I~~~DlR~~~~e~--------~ 1294 (1387)
T KOG1517|consen 1224 IAAGFADGSVRVYDRRMAPPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQDGD-IQLLDLRMSSKET--------F 1294 (1387)
T ss_pred EEEeecCCceEEeecccCCccccceeecccCCcccceeEEeecCCCcceeeeccCCe-EEEEecccCcccc--------c
Confidence 455667899999998753 467888999987 999999998876 999999997 9999998731111 0
Q ss_pred eeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 457 YVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 457 ~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
....+.-..|. ..+++...++...+|+|+. +.|+||++.- .....++.+
T Consensus 1295 ~~iv~~~~yGs---~lTal~VH~hapiiAsGs~-q~ikIy~~~G-~~l~~~k~n 1343 (1387)
T KOG1517|consen 1295 LTIVAHWEYGS---ALTALTVHEHAPIIASGSA-QLIKIYSLSG-EQLNIIKYN 1343 (1387)
T ss_pred ceeeeccccCc---cceeeeeccCCCeeeecCc-ceEEEEecCh-hhhcccccC
Confidence 11111111242 3778999999999999999 9999999853 344455544
No 207
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.35 E-value=8.6e-07 Score=67.48 Aligned_cols=38 Identities=29% Similarity=0.680 Sum_probs=36.1
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEe
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFK 439 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWd 439 (921)
+++.+|++|.++|.+|+|+|++.+|||++.|++ |+|||
T Consensus 2 ~~~~~~~~h~~~i~~i~~~~~~~~~~s~~~D~~-i~vwd 39 (39)
T PF00400_consen 2 KCVRTFRGHSSSINSIAWSPDGNFLASGSSDGT-IRVWD 39 (39)
T ss_dssp EEEEEEESSSSSEEEEEEETTSSEEEEEETTSE-EEEEE
T ss_pred eEEEEEcCCCCcEEEEEEecccccceeeCCCCE-EEEEC
Confidence 578999999999999999999999999999987 99997
No 208
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=98.34 E-value=4.5e-05 Score=83.04 Aligned_cols=118 Identities=15% Similarity=0.217 Sum_probs=84.8
Q ss_pred cccccCCCCEEEEEECCCC----ceEEEeccCCCCeEEEEECCC--CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 382 HFPDADNVGMVIVRDIVSK----NVIAQFRAHKSPISALCFDPS--GILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~----~~l~~~~aH~~pIsaLaFSPd--GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
..+++..|++|+|||..+. .+-...++|.+.|..+.+-+- |+.+|+||.|++ +.||.-....... . +.
T Consensus 27 RmAtCSsDq~vkI~d~~~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS~Drt-v~iWEE~~~~~~~-~----~~ 100 (361)
T KOG2445|consen 27 RMATCSSDQTVKIWDSTSDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCSYDRT-VSIWEEQEKSEEA-H----GR 100 (361)
T ss_pred eeeeccCCCcEEEEeccCCCCceEEeeeEEecCCcEEEEEecCccccceEEEEecCCc-eeeeeeccccccc-c----cc
Confidence 3456778899999997543 577889999999999999774 999999999998 8999764320000 0 00
Q ss_pred ceeEEEEEecccccccEEEEEEcc--CCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 456 SYVHLYRLQRGLTNAVIQDISFSD--DSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~I~sIaFSP--Dg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
.=....+|. .....|++|+|+| -|-.||+++.||++|||+.-.......+
T Consensus 101 ~Wv~~ttl~--DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W 152 (361)
T KOG2445|consen 101 RWVRRTTLV--DSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQW 152 (361)
T ss_pred eeEEEEEee--cCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccc
Confidence 001112221 1122499999998 5889999999999999998776665544
No 209
>PRK00178 tolB translocation protein TolB; Provisional
Probab=98.34 E-value=0.00028 Score=81.59 Aligned_cols=51 Identities=12% Similarity=0.123 Sum_probs=37.5
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEe--C--CEEEEEECCCCcE
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQ--A--AQVHCFDAATLEI 256 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~--d--~~I~IwDl~T~~~ 256 (921)
..|.+||+.+++......++..+...+++ ++.|+++. + ..|++||+.+++.
T Consensus 223 ~~l~~~~l~~g~~~~l~~~~g~~~~~~~SpDG~~la~~~~~~g~~~Iy~~d~~~~~~ 279 (430)
T PRK00178 223 PRIFVQNLDTGRREQITNFEGLNGAPAWSPDGSKLAFVLSKDGNPEIYVMDLASRQL 279 (430)
T ss_pred CEEEEEECCCCCEEEccCCCCCcCCeEECCCCCEEEEEEccCCCceEEEEECCCCCe
Confidence 46899999999876655666666678887 46776533 2 2799999998764
No 210
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.33 E-value=5.3e-05 Score=88.10 Aligned_cols=95 Identities=19% Similarity=0.177 Sum_probs=61.8
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
.|.+||+.+++.. .+..+...+...+|+|||+.|+.++.++...+||.+... . +....+ .. .+ .
T Consensus 268 ~I~~~d~~tg~~~-~lt~~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~-~---------g~~~~l-t~-~~---~ 331 (429)
T PRK03629 268 NLYVMDLASGQIR-QVTDGRSNNTEPTWFPDSQNLAYTSDQAGRPQVYKVNIN-G---------GAPQRI-TW-EG---S 331 (429)
T ss_pred EEEEEECCCCCEE-EccCCCCCcCceEECCCCCEEEEEeCCCCCceEEEEECC-C---------CCeEEe-ec-CC---C
Confidence 5889999888764 444445577889999999999888775433567754332 0 011222 11 11 1
Q ss_pred cEEEEEEccCCCEEEEEeCCC---cEEEEecCCC
Q 002446 471 VIQDISFSDDSNWIMISSSRG---TSHLFAINPL 501 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~~~ 501 (921)
...+.+|||||++|+..+.++ .+.+||+...
T Consensus 332 ~~~~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~~g 365 (429)
T PRK03629 332 QNQDADVSSDGKFMVMVSSNGGQQHIAKQDLATG 365 (429)
T ss_pred CccCEEECCCCCEEEEEEccCCCceEEEEECCCC
Confidence 256789999999998876543 4667777553
No 211
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.33 E-value=0.00012 Score=85.03 Aligned_cols=92 Identities=12% Similarity=0.177 Sum_probs=61.4
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC-CC-EEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ-GH-NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D-Gt-~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|.+||+.+++. ..+..|.......+|+|||+.|+.++.. |. .|.+||+..+ ..+. +..+
T Consensus 270 ~~Iy~~d~~~~~~-~~Lt~~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~g~------------~~~~---lt~~- 332 (435)
T PRK05137 270 TDIYTMDLRSGTT-TRLTDSPAIDTSPSYSPDGSQIVFESDRSGSPQLYVMNADGS------------NPRR---ISFG- 332 (435)
T ss_pred ceEEEEECCCCce-EEccCCCCccCceeEcCCCCEEEEEECCCCCCeEEEEECCCC------------CeEE---eecC-
Confidence 4588889988765 4566676667789999999999988753 32 3666676543 1222 2211
Q ss_pred ccccEEEEEEccCCCEEEEEeCCC---cEEEEecC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRG---TSHLFAIN 499 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~ 499 (921)
...+...+|||||++||..+.++ .|.+|++.
T Consensus 333 -~~~~~~~~~SpdG~~ia~~~~~~~~~~i~~~d~~ 366 (435)
T PRK05137 333 -GGRYSTPVWSPRGDLIAFTKQGGGQFSIGVMKPD 366 (435)
T ss_pred -CCcccCeEECCCCCEEEEEEcCCCceEEEEEECC
Confidence 12356788999999999877543 46666653
No 212
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.30 E-value=6.6e-05 Score=87.17 Aligned_cols=95 Identities=12% Similarity=0.113 Sum_probs=61.4
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
.|.++|+.++. +..+..|...+...+|+|||+.|+..+..+....||.+... . +....+ .+. +.
T Consensus 265 ~Iy~~d~~~~~-~~~lt~~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy~~~~~-~---------g~~~~l-t~~-g~--- 328 (427)
T PRK02889 265 QIYTVNADGSG-LRRLTQSSGIDTEPFFSPDGRSIYFTSDRGGAPQIYRMPAS-G---------GAAQRV-TFT-GS--- 328 (427)
T ss_pred eEEEEECCCCC-cEECCCCCCCCcCeEEcCCCCEEEEEecCCCCcEEEEEECC-C---------CceEEE-ecC-CC---
Confidence 35556666554 45566666666778999999999877764333678876532 0 011222 222 21
Q ss_pred cEEEEEEccCCCEEEEEeCCC---cEEEEecCCC
Q 002446 471 VIQDISFSDDSNWIMISSSRG---TSHLFAINPL 501 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~~~ 501 (921)
.....+|||||++||..+.++ .|.+||+...
T Consensus 329 ~~~~~~~SpDG~~Ia~~s~~~g~~~I~v~d~~~g 362 (427)
T PRK02889 329 YNTSPRISPDGKLLAYISRVGGAFKLYVQDLATG 362 (427)
T ss_pred CcCceEECCCCCEEEEEEccCCcEEEEEEECCCC
Confidence 134678999999999887665 5899998764
No 213
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.29 E-value=9.5e-06 Score=86.69 Aligned_cols=58 Identities=22% Similarity=0.315 Sum_probs=54.7
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKI 440 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi 440 (921)
.+++++-||.|+||..++.++++.++-|...|.+|+|+||..++|.||.|++ |-+|++
T Consensus 265 IlATAGWD~RiRVyswrtl~pLAVLkyHsagvn~vAfspd~~lmAaaskD~r-ISLWkL 322 (323)
T KOG0322|consen 265 ILATAGWDHRIRVYSWRTLNPLAVLKYHSAGVNAVAFSPDCELMAAASKDAR-ISLWKL 322 (323)
T ss_pred EEeecccCCcEEEEEeccCCchhhhhhhhcceeEEEeCCCCchhhhccCCce-EEeeec
Confidence 4677889999999999999999999999999999999999999999999987 999986
No 214
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=98.26 E-value=2.3e-06 Score=99.58 Aligned_cols=144 Identities=13% Similarity=0.249 Sum_probs=107.4
Q ss_pred CEEEEEEc--CCEEEEEeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccceeecCceEEecCCCceecCCCcc
Q 002446 227 PIYSVRCS--SRVVAICQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLAVGPRWLAYSGSPVVVSNDGRV 304 (921)
Q Consensus 227 ~V~sV~~S--~riLAVa~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piAlgpRwLAyas~~~~~s~~Grv 304 (921)
.|++|+|- +.-|+++.++++++||...+..++++.+|.+.. ..+||+-+
T Consensus 14 ci~d~afkPDGsqL~lAAg~rlliyD~ndG~llqtLKgHKDtV-------------------ycVAys~d---------- 64 (1081)
T KOG1538|consen 14 CINDIAFKPDGTQLILAAGSRLLVYDTSDGTLLQPLKGHKDTV-------------------YCVAYAKD---------- 64 (1081)
T ss_pred chheeEECCCCceEEEecCCEEEEEeCCCcccccccccccceE-------------------EEEEEccC----------
Confidence 78888885 456777888999999999999999999986521 12456510
Q ss_pred CCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCcCCcccccCCCCCCCcccCccc
Q 002446 305 NPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQNSLQSAIPGGKSNGTVNGHFP 384 (921)
Q Consensus 305 sPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~~si~sa~~~~k~~g~v~g~~~ 384 (921)
|+ .|+
T Consensus 65 -----------------Gk----------------------------------------------------------rFA 69 (1081)
T KOG1538|consen 65 -----------------GK----------------------------------------------------------RFA 69 (1081)
T ss_pred -----------------Cc----------------------------------------------------------eec
Confidence 11 133
Q ss_pred ccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
++..|..|.||.-. ....++ .|+..|.||.|+|-...||||+-.. +-+|..... .+.+.
T Consensus 70 SG~aDK~VI~W~~k---lEG~LkYSH~D~IQCMsFNP~~h~LasCsLsd--FglWS~~qK---------------~V~K~ 129 (1081)
T KOG1538|consen 70 SGSADKSVIIWTSK---LEGILKYSHNDAIQCMSFNPITHQLASCSLSD--FGLWSPEQK---------------SVSKH 129 (1081)
T ss_pred cCCCceeEEEeccc---ccceeeeccCCeeeEeecCchHHHhhhcchhh--ccccChhhh---------------hHHhh
Confidence 45567889999754 334455 7999999999999999999999763 778976642 11111
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
+ ..++|.+++|..||+|||.|-.+|||-|-+
T Consensus 130 -k--ss~R~~~CsWtnDGqylalG~~nGTIsiRN 160 (1081)
T KOG1538|consen 130 -K--SSSRIICCSWTNDGQYLALGMFNGTISIRN 160 (1081)
T ss_pred -h--hheeEEEeeecCCCcEEEEeccCceEEeec
Confidence 1 245699999999999999999999999863
No 215
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=98.26 E-value=3.1e-05 Score=82.07 Aligned_cols=109 Identities=12% Similarity=0.263 Sum_probs=75.2
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCCeEEEEE-CCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSPISALCF-DPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaF-SPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
++.|+.++-||+++|+...++++|+..|.++.- +.+| .+.|+++||+ +||||+.++.+-.. -+ ...+ ..+-
T Consensus 132 AgGD~~~y~~dlE~G~i~r~~rGHtDYvH~vv~R~~~~-qilsG~EDGt-vRvWd~kt~k~v~~--ie---~yk~-~~~l 203 (325)
T KOG0649|consen 132 AGGDGVIYQVDLEDGRIQREYRGHTDYVHSVVGRNANG-QILSGAEDGT-VRVWDTKTQKHVSM--IE---PYKN-PNLL 203 (325)
T ss_pred ecCCeEEEEEEecCCEEEEEEcCCcceeeeeeecccCc-ceeecCCCcc-EEEEeccccceeEE--ec---cccC-hhhc
Confidence 346899999999999999999999999999998 5555 4789999998 89999998611000 00 0000 1122
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCce
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
|-+....|-+++ -|..|+++|+.. ..-||.+.......
T Consensus 204 Rp~~g~wigala--~~edWlvCGgGp-~lslwhLrsse~t~ 241 (325)
T KOG0649|consen 204 RPDWGKWIGALA--VNEDWLVCGGGP-KLSLWHLRSSESTC 241 (325)
T ss_pred CcccCceeEEEe--ccCceEEecCCC-ceeEEeccCCCceE
Confidence 333333355554 567799888754 68899998764443
No 216
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.25 E-value=7.7e-06 Score=89.86 Aligned_cols=105 Identities=17% Similarity=0.251 Sum_probs=76.3
Q ss_pred ccCCCCEEEEEECCCCceEEEec--cCC-CCeEEEEECCCCCEEEEEecCC---CEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFR--AHK-SPISALCFDPSGILLVTASVQG---HNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~--aH~-~pIsaLaFSPdGtlLATaS~DG---t~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
++..+|+|++||+++...++.+. +|. .|..|++.+-.+.+++++...- -.+.+||+... .+
T Consensus 89 s~ssDG~Vr~wD~Rs~~e~a~~~~~~~~~~~f~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~-------------qq 155 (376)
T KOG1188|consen 89 SCSSDGTVRLWDIRSQAESARISWTQQSGTPFICLDLNCKKNIIACGTELTRSDASVVLWDVRSE-------------QQ 155 (376)
T ss_pred EeccCCeEEEEEeecchhhhheeccCCCCCcceEeeccCcCCeEEeccccccCceEEEEEEeccc-------------cc
Confidence 34568999999999877665554 666 4677777777889999886532 24889999874 01
Q ss_pred EEEEEecccccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCCCC
Q 002446 459 HLYRLQRGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
.+..+..- +.-.|++|.|.| |-..|++||.||-|-|||+....+
T Consensus 156 ~l~~~~eS-H~DDVT~lrFHP~~pnlLlSGSvDGLvnlfD~~~d~E 200 (376)
T KOG1188|consen 156 LLRQLNES-HNDDVTQLRFHPSDPNLLLSGSVDGLVNLFDTKKDNE 200 (376)
T ss_pred hhhhhhhh-ccCcceeEEecCCCCCeEEeecccceEEeeecCCCcc
Confidence 12222222 334599999999 678999999999999999986533
No 217
>PRK04792 tolB translocation protein TolB; Provisional
Probab=98.22 E-value=0.00066 Score=79.56 Aligned_cols=51 Identities=16% Similarity=0.158 Sum_probs=35.7
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEe--CC--EEEEEECCCCcE
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQ--AA--QVHCFDAATLEI 256 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~--d~--~I~IwDl~T~~~ 256 (921)
..|.+||+.+++......++.......++ ++.|+++. ++ .|+++|+.+++.
T Consensus 242 ~~L~~~dl~tg~~~~lt~~~g~~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~tg~~ 298 (448)
T PRK04792 242 AEIFVQDIYTQVREKVTSFPGINGAPRFSPDGKKLALVLSKDGQPEIYVVDIATKAL 298 (448)
T ss_pred cEEEEEECCCCCeEEecCCCCCcCCeeECCCCCEEEEEEeCCCCeEEEEEECCCCCe
Confidence 46999999999865544556555677886 46666532 33 699999988764
No 218
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.22 E-value=4.1e-07 Score=108.01 Aligned_cols=96 Identities=22% Similarity=0.383 Sum_probs=84.1
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+.++.++-.|+||...+..+++..++|.+.|+.++.+.+..++|++|.|. +|++|.+..+ ..+ .
T Consensus 205 Iitgsdd~lvKiwS~et~~~lAs~rGhs~ditdlavs~~n~~iaaaS~D~-vIrvWrl~~~--------------~pv-s 268 (1113)
T KOG0644|consen 205 IITGSDDRLVKIWSMETARCLASCRGHSGDITDLAVSSNNTMIAAASNDK-VIRVWRLPDG--------------APV-S 268 (1113)
T ss_pred EeecCccceeeeeeccchhhhccCCCCccccchhccchhhhhhhhcccCc-eEEEEecCCC--------------chH-H
Confidence 34567788999999999999999999999999999999999999999995 7999999876 222 3
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+-|||+.| |++|+|||-- +++.|||+++||..
T Consensus 269 vLrghtga-vtaiafsP~~----sss~dgt~~~wd~r 300 (1113)
T KOG0644|consen 269 VLRGHTGA-VTAIAFSPRA----SSSDDGTCRIWDAR 300 (1113)
T ss_pred HHhccccc-eeeeccCccc----cCCCCCceEecccc
Confidence 44898876 9999999965 88999999999986
No 219
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=98.22 E-value=0.00035 Score=79.96 Aligned_cols=183 Identities=15% Similarity=0.130 Sum_probs=113.8
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEE-EEEEc--CCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccc
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIY-SVRCS--SRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGP 281 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~-sV~~S--~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~p 281 (921)
+.|.|.|..+.+.+.++.....+. .+.++ +|++.| ..++.|.++|+.+++.+.++..... |
T Consensus 16 ~~v~viD~~t~~~~~~i~~~~~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~G~~---------------~ 80 (369)
T PF02239_consen 16 GSVAVIDGATNKVVARIPTGGAPHAGLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKVGGN---------------P 80 (369)
T ss_dssp TEEEEEETTT-SEEEEEE-STTEEEEEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE-SSE---------------E
T ss_pred CEEEEEECCCCeEEEEEcCCCCceeEEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEecCCC---------------c
Confidence 679999999999999999765554 46666 477666 6688999999999999888875321 1
Q ss_pred eeecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCC
Q 002446 282 LAVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPD 361 (921)
Q Consensus 282 iAlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~ 361 (921)
+-+|++. .|+.+ +
T Consensus 81 -----~~i~~s~---------------------------DG~~~-----------~------------------------ 93 (369)
T PF02239_consen 81 -----RGIAVSP---------------------------DGKYV-----------Y------------------------ 93 (369)
T ss_dssp -----EEEEE-----------------------------TTTEE-----------E------------------------
T ss_pred -----ceEEEcC---------------------------CCCEE-----------E------------------------
Confidence 2233331 11111 1
Q ss_pred CcCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccC-------CCCeEEEEECCCCCEEEEEecCCCE
Q 002446 362 SQNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAH-------KSPISALCFDPSGILLVTASVQGHN 434 (921)
Q Consensus 362 ~~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH-------~~pIsaLaFSPdGtlLATaS~DGt~ 434 (921)
+....++.|.|+|..+.+++.++... .+.+.+|..+|....++.+-.|...
T Consensus 94 ----------------------v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~ 151 (369)
T PF02239_consen 94 ----------------------VANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGE 151 (369)
T ss_dssp ----------------------EEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTE
T ss_pred ----------------------EEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCe
Confidence 00122478999999999999988743 3468899999999988877777443
Q ss_pred EEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEE-eCCCcEEEEecCCCCCceee
Q 002446 435 INIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMIS-SSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 435 IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsg-S~DgTVhVWdi~~~g~~~~l 507 (921)
|-+-|.... .......+..|. ...+..|+||++|+.++ ..++.+-++|..+.+....+
T Consensus 152 I~vVdy~d~------------~~~~~~~i~~g~---~~~D~~~dpdgry~~va~~~sn~i~viD~~~~k~v~~i 210 (369)
T PF02239_consen 152 IWVVDYSDP------------KNLKVTTIKVGR---FPHDGGFDPDGRYFLVAANGSNKIAVIDTKTGKLVALI 210 (369)
T ss_dssp EEEEETTTS------------SCEEEEEEE--T---TEEEEEE-TTSSEEEEEEGGGTEEEEEETTTTEEEEEE
T ss_pred EEEEEeccc------------cccceeeecccc---cccccccCcccceeeecccccceeEEEeeccceEEEEe
Confidence 545565442 112223333332 26799999999987664 56779999998876444343
No 220
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.22 E-value=2.2e-06 Score=98.30 Aligned_cols=101 Identities=15% Similarity=0.218 Sum_probs=80.8
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc--
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD-- 479 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP-- 479 (921)
..+.+.+|++-|.||.|+.||.+||+||+|-+ +.|||.... +.++.++.||+ +.|.++.|=|
T Consensus 42 lE~eL~GH~GCVN~LeWn~dG~lL~SGSDD~r-~ivWd~~~~--------------KllhsI~TgHt-aNIFsvKFvP~t 105 (758)
T KOG1310|consen 42 LEAELTGHTGCVNCLEWNADGELLASGSDDTR-LIVWDPFEY--------------KLLHSISTGHT-ANIFSVKFVPYT 105 (758)
T ss_pred hhhhhccccceecceeecCCCCEEeecCCcce-EEeecchhc--------------ceeeeeecccc-cceeEEeeeccC
Confidence 34678999999999999999999999999965 899998753 56677778876 5699999987
Q ss_pred CCCEEEEEeCCCcEEEEecCCCCC----------ceeecCCCCCccccc
Q 002446 480 DSNWIMISSSRGTSHLFAINPLGG----------SVNFQPTDANFTTKH 518 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVWdi~~~g~----------~~~l~~H~~~~~~~~ 518 (921)
..+.+++|..|..|||||+...++ ...+..|...+.+..
T Consensus 106 nnriv~sgAgDk~i~lfdl~~~~~~~~d~~~~~~~~~~~cht~rVKria 154 (758)
T KOG1310|consen 106 NNRIVLSGAGDKLIKLFDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIA 154 (758)
T ss_pred CCeEEEeccCcceEEEEecccccccccccCccchhhhhhhhhhhhhhee
Confidence 578899999999999999985221 123466766665543
No 221
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=98.19 E-value=1.4e-05 Score=83.30 Aligned_cols=95 Identities=11% Similarity=0.274 Sum_probs=66.9
Q ss_pred CEEEEEECCC-CceEEEec-cCCCCeEEEEECCCCCEEEEEe--cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 390 GMVIVRDIVS-KNVIAQFR-AHKSPISALCFDPSGILLVTAS--VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 390 G~V~IwDl~s-~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS--~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
|...||.+.. ...+..+. ...++|.+++|+|+|+.||.+. .++ .|.|||+.. ..++++..
T Consensus 37 ~~~~l~~~~~~~~~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~~~-~v~lyd~~~---------------~~i~~~~~ 100 (194)
T PF08662_consen 37 GEFELFYLNEKNIPVESIELKKEGPIHDVAWSPNGNEFAVIYGSMPA-KVTLYDVKG---------------KKIFSFGT 100 (194)
T ss_pred eeEEEEEEecCCCccceeeccCCCceEEEEECcCCCEEEEEEccCCc-ccEEEcCcc---------------cEeEeecC
Confidence 4455555532 23445554 3346899999999999987664 344 499999963 35566643
Q ss_pred ccccccEEEEEEccCCCEEEEEeCC---CcEEEEecCCCCCc
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSR---GTSHLFAINPLGGS 504 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~D---gTVhVWdi~~~g~~ 504 (921)
..+..|.|||+|++||+++.+ |.+.+||+......
T Consensus 101 ----~~~n~i~wsP~G~~l~~~g~~n~~G~l~~wd~~~~~~i 138 (194)
T PF08662_consen 101 ----QPRNTISWSPDGRFLVLAGFGNLNGDLEFWDVRKKKKI 138 (194)
T ss_pred ----CCceEEEECCCCCEEEEEEccCCCcEEEEEECCCCEEe
Confidence 247889999999999998754 66999999865433
No 222
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=98.17 E-value=0.0016 Score=72.58 Aligned_cols=106 Identities=13% Similarity=0.220 Sum_probs=71.0
Q ss_pred CCEEEEEECCCC-ceEEEeccC---------CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 389 VGMVIVRDIVSK-NVIAQFRAH---------KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 389 ~G~V~IwDl~s~-~~l~~~~aH---------~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
+++|.+|+.... ..+..++.+ .....+|..+|||++|..+..--..|-+|.+.+. . .
T Consensus 212 ~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasNRg~dsI~~f~V~~~------------~-g 278 (346)
T COG2706 212 NSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASNRGHDSIAVFSVDPD------------G-G 278 (346)
T ss_pred CCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEecCCCCeEEEEEEcCC------------C-C
Confidence 456777776652 222333322 2467889999999999987765567899999875 0 1
Q ss_pred EEEEEeccccccc-EEEEEEccCCCEEEEEeCCC-cEEEEecCCCCCceee
Q 002446 459 HLYRLQRGLTNAV-IQDISFSDDSNWIMISSSRG-TSHLFAINPLGGSVNF 507 (921)
Q Consensus 459 ~l~~l~RG~t~a~-I~sIaFSPDg~~LAsgS~Dg-TVhVWdi~~~g~~~~l 507 (921)
+|--+.+-.+... -.+..|+|++++|+++..++ +++||.+++..+....
T Consensus 279 ~L~~~~~~~teg~~PR~F~i~~~g~~Liaa~q~sd~i~vf~~d~~TG~L~~ 329 (346)
T COG2706 279 KLELVGITPTEGQFPRDFNINPSGRFLIAANQKSDNITVFERDKETGRLTL 329 (346)
T ss_pred EEEEEEEeccCCcCCccceeCCCCCEEEEEccCCCcEEEEEEcCCCceEEe
Confidence 1222222222232 57899999999999888754 7999999987776554
No 223
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.16 E-value=2.5e-05 Score=90.36 Aligned_cols=57 Identities=23% Similarity=0.402 Sum_probs=53.1
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCC
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~ 442 (921)
....+++|+++|..++.+++...+|...+++++|.|+|-+|++++.||. +++|.+..
T Consensus 506 ~~hed~~Ir~~dn~~~~~l~s~~a~~~svtslai~~ng~~l~s~s~d~s-v~l~kld~ 562 (577)
T KOG0642|consen 506 TAHEDRSIRFFDNKTGKILHSMVAHKDSVTSLAIDPNGPYLMSGSHDGS-VRLWKLDV 562 (577)
T ss_pred ecccCCceecccccccccchheeeccceecceeecCCCceEEeecCCce-eehhhccc
Confidence 4567899999999999999999999999999999999999999999997 89998864
No 224
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.11 E-value=0.0015 Score=76.25 Aligned_cols=93 Identities=15% Similarity=0.169 Sum_probs=57.4
Q ss_pred EEEEECCC-CceEEEeccCCCCeEEEEECCCCCEEEEEecCC--CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 392 VIVRDIVS-KNVIAQFRAHKSPISALCFDPSGILLVTASVQG--HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 392 V~IwDl~s-~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
|.++++.. +.....+..+...+...+|||||++||.++.++ ..|.+||+..+ ... .+..+
T Consensus 307 ly~~~~~~~g~~~~~lt~~~~~~~~p~wSPDG~~Laf~~~~~g~~~I~v~dl~~g------------~~~---~Lt~~-- 369 (428)
T PRK01029 307 IYIMQIDPEGQSPRLLTKKYRNSSCPAWSPDGKKIAFCSVIKGVRQICVYDLATG------------RDY---QLTTS-- 369 (428)
T ss_pred EEEEECcccccceEEeccCCCCccceeECCCCCEEEEEEcCCCCcEEEEEECCCC------------CeE---EccCC--
Confidence 44444432 222344445556777899999999998776542 35889998765 112 22222
Q ss_pred cccEEEEEEccCCCEEEEEeC-C--CcEEEEecCCC
Q 002446 469 NAVIQDISFSDDSNWIMISSS-R--GTSHLFAINPL 501 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~-D--gTVhVWdi~~~ 501 (921)
...+.+.+|+|||++|+..+. + ..+.++++...
T Consensus 370 ~~~~~~p~wSpDG~~L~f~~~~~g~~~L~~vdl~~g 405 (428)
T PRK01029 370 PENKESPSWAIDSLHLVYSAGNSNESELYLISLITK 405 (428)
T ss_pred CCCccceEECCCCCEEEEEECCCCCceEEEEECCCC
Confidence 123678999999999986543 3 34666666543
No 225
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=98.10 E-value=2.7e-05 Score=88.94 Aligned_cols=105 Identities=21% Similarity=0.358 Sum_probs=78.3
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
..+|.|.|.|..+.+++..+.....+-..++|+|||++|.+++.||. |.++|+.+. +.+.+++-|
T Consensus 13 ~~~~~v~viD~~t~~~~~~i~~~~~~h~~~~~s~Dgr~~yv~~rdg~-vsviD~~~~--------------~~v~~i~~G 77 (369)
T PF02239_consen 13 RGSGSVAVIDGATNKVVARIPTGGAPHAGLKFSPDGRYLYVANRDGT-VSVIDLATG--------------KVVATIKVG 77 (369)
T ss_dssp GGGTEEEEEETTT-SEEEEEE-STTEEEEEE-TT-SSEEEEEETTSE-EEEEETTSS--------------SEEEEEE-S
T ss_pred cCCCEEEEEECCCCeEEEEEcCCCCceeEEEecCCCCEEEEEcCCCe-EEEEECCcc--------------cEEEEEecC
Confidence 45689999999999999999976555556889999999999999986 899999986 456677656
Q ss_pred cccccEEEEEEccCCCEEEEEe-CCCcEEEEecCCCCCceeecC
Q 002446 467 LTNAVIQDISFSDDSNWIMISS-SRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS-~DgTVhVWdi~~~g~~~~l~~ 509 (921)
.. -.++++|+||+|++++. ..+++.|+|..+......+..
T Consensus 78 ~~---~~~i~~s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~ 118 (369)
T PF02239_consen 78 GN---PRGIAVSPDGKYVYVANYEPGTVSVIDAETLEPVKTIPT 118 (369)
T ss_dssp SE---EEEEEE--TTTEEEEEEEETTEEEEEETTT--EEEEEE-
T ss_pred CC---cceEEEcCCCCEEEEEecCCCceeEeccccccceeeccc
Confidence 43 57899999999999876 689999999988755555543
No 226
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=98.07 E-value=0.00016 Score=80.36 Aligned_cols=102 Identities=17% Similarity=0.255 Sum_probs=74.2
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
+..|+|||..++..+....---+.++-|.|||||.+|..|.-|+. ++||+.... +. ..-+.+-
T Consensus 217 sssi~iWdpdtg~~~pL~~~glgg~slLkwSPdgd~lfaAt~dav-frlw~e~q~--wt----------~erw~lg---- 279 (445)
T KOG2139|consen 217 SSSIMIWDPDTGQKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAV-FRLWQENQS--WT----------KERWILG---- 279 (445)
T ss_pred cceEEEEcCCCCCcccccccCCCceeeEEEcCCCCEEEEecccce-eeeehhccc--ce----------ecceecc----
Confidence 357999999998876555455678999999999999999999986 999965542 00 1112232
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
...|+.-+|+|+|++|..+.. |.-+||.+.-.++...+.
T Consensus 280 sgrvqtacWspcGsfLLf~~s-gsp~lysl~f~~~~~~~~ 318 (445)
T KOG2139|consen 280 SGRVQTACWSPCGSFLLFACS-GSPRLYSLTFDGEDSVFL 318 (445)
T ss_pred CCceeeeeecCCCCEEEEEEc-CCceEEEEeecCCCcccc
Confidence 236999999999999987765 455688887655554443
No 227
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=98.06 E-value=0.00011 Score=87.52 Aligned_cols=107 Identities=14% Similarity=0.104 Sum_probs=73.8
Q ss_pred cccccCCCCEEEEEE---CCCC-----ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCC
Q 002446 382 HFPDADNVGMVIVRD---IVSK-----NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDA 453 (921)
Q Consensus 382 ~~~s~~~~G~V~IwD---l~s~-----~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~ 453 (921)
+|+-+...|.|.--. .... +.+..+..|.++|.++.|+|=+..+..++.|.+ ++||.-...
T Consensus 362 ~FiVGTe~G~v~~~~r~g~~~~~~~~~~~~~~~~~h~g~v~~v~~nPF~~k~fls~gDW~-vriWs~~~~---------- 430 (555)
T KOG1587|consen 362 HFIVGTEEGKVYKGCRKGYTPAPEVSYKGHSTFITHIGPVYAVSRNPFYPKNFLSVGDWT-VRIWSEDVI---------- 430 (555)
T ss_pred eEEEEcCCcEEEEEeccCCcccccccccccccccccCcceEeeecCCCccceeeeeccce-eEeccccCC----------
Confidence 344455667776622 2211 335577789999999999998887666666876 899987632
Q ss_pred CCceeEEEEEecccccccEEEEEEccC-CCEEEEEeCCCcEEEEecCCCCCc
Q 002446 454 GTSYVHLYRLQRGLTNAVIQDISFSDD-SNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 454 ~~~~~~l~~l~RG~t~a~I~sIaFSPD-g~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
...++.+.+- ...|++++|||- ...||++..||++.|||+......
T Consensus 431 ---~~Pl~~~~~~--~~~v~~vaWSptrpavF~~~d~~G~l~iWDLl~~~~~ 477 (555)
T KOG1587|consen 431 ---ASPLLSLDSS--PDYVTDVAWSPTRPAVFATVDGDGNLDIWDLLQDDEE 477 (555)
T ss_pred ---CCcchhhhhc--cceeeeeEEcCcCceEEEEEcCCCceehhhhhccccC
Confidence 1223344332 234999999996 467889999999999999764333
No 228
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=98.02 E-value=0.00043 Score=79.02 Aligned_cols=93 Identities=17% Similarity=0.220 Sum_probs=61.9
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC-C-EEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG-H-NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG-t-~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|.+||+.++.. ..+..|.......+|+|||+.|+.++.++ . .|.++|+..+ ... .+..+
T Consensus 258 ~~i~~~d~~~~~~-~~l~~~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~~~------------~~~---~l~~~- 320 (417)
T TIGR02800 258 PDIYVMDLDGKQL-TRLTNGPGIDTEPSWSPDGKSIAFTSDRGGSPQIYMMDADGG------------EVR---RLTFR- 320 (417)
T ss_pred ccEEEEECCCCCE-EECCCCCCCCCCEEECCCCCEEEEEECCCCCceEEEEECCCC------------CEE---EeecC-
Confidence 3588889887754 44555555566789999999988777643 2 3555565543 111 22211
Q ss_pred ccccEEEEEEccCCCEEEEEeCCC---cEEEEecCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRG---TSHLFAINP 500 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~~ 500 (921)
...+..++|||||++|+.++.++ .|.+||+..
T Consensus 321 -~~~~~~~~~spdg~~i~~~~~~~~~~~i~~~d~~~ 355 (417)
T TIGR02800 321 -GGYNASPSWSPDGDLIAFVHREGGGFNIAVMDLDG 355 (417)
T ss_pred -CCCccCeEECCCCCEEEEEEccCCceEEEEEeCCC
Confidence 12366789999999999998876 677777765
No 229
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.95 E-value=0.00035 Score=78.27 Aligned_cols=80 Identities=15% Similarity=0.227 Sum_probs=62.3
Q ss_pred CCCCEEEEEECCCCceEEE-eccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 387 DNVGMVIVRDIVSKNVIAQ-FRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~-~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
+.-|.+..+|+..++.+.. |++-++.|++|-..|.+.+||+|+-|. .+||||+.+. ..++..+
T Consensus 266 n~~g~l~~FD~r~~kl~g~~~kg~tGsirsih~hp~~~~las~GLDR-yvRIhD~ktr--------------kll~kvY- 329 (412)
T KOG3881|consen 266 NTKGQLAKFDLRGGKLLGCGLKGITGSIRSIHCHPTHPVLASCGLDR-YVRIHDIKTR--------------KLLHKVY- 329 (412)
T ss_pred cccchhheecccCceeeccccCCccCCcceEEEcCCCceEEeeccce-eEEEeecccc--------------hhhhhhh-
Confidence 4457888999999988877 889999999999999999999999995 5999999984 2333332
Q ss_pred ccccccEEEEEEccCCCEE
Q 002446 466 GLTNAVIQDISFSDDSNWI 484 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~L 484 (921)
-.+.+++|-+.++-.+.
T Consensus 330 --vKs~lt~il~~~~~n~e 346 (412)
T KOG3881|consen 330 --VKSRLTFILLRDDVNIE 346 (412)
T ss_pred --hhccccEEEecCCcccc
Confidence 22347788887765543
No 230
>PRK00178 tolB translocation protein TolB; Provisional
Probab=97.86 E-value=0.0021 Score=74.38 Aligned_cols=93 Identities=15% Similarity=0.171 Sum_probs=59.3
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC-CC-EEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ-GH-NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D-Gt-~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.+||+.+++. ..+..+........|+|||+.|+..+.. |. .|.++|+..+ ....+ .. .+.
T Consensus 268 ~Iy~~d~~~~~~-~~lt~~~~~~~~~~~spDg~~i~f~s~~~g~~~iy~~d~~~g------------~~~~l-t~-~~~- 331 (430)
T PRK00178 268 EIYVMDLASRQL-SRVTNHPAIDTEPFWGKDGRTLYFTSDRGGKPQIYKVNVNGG------------RAERV-TF-VGN- 331 (430)
T ss_pred eEEEEECCCCCe-EEcccCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECCCC------------CEEEe-ec-CCC-
Confidence 588889988765 3455566666778999999988877654 32 3555566543 12222 21 121
Q ss_pred cccEEEEEEccCCCEEEEEeCC-C--cEEEEecCCC
Q 002446 469 NAVIQDISFSDDSNWIMISSSR-G--TSHLFAINPL 501 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~D-g--TVhVWdi~~~ 501 (921)
.....+|||||++|+..+.+ + .|.+||+.+.
T Consensus 332 --~~~~~~~Spdg~~i~~~~~~~~~~~l~~~dl~tg 365 (430)
T PRK00178 332 --YNARPRLSADGKTLVMVHRQDGNFHVAAQDLQRG 365 (430)
T ss_pred --CccceEECCCCCEEEEEEccCCceEEEEEECCCC
Confidence 13457899999999988754 3 3666776553
No 231
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=97.85 E-value=0.00023 Score=78.12 Aligned_cols=111 Identities=15% Similarity=0.142 Sum_probs=76.9
Q ss_pred CCCEEEEEEC-CCCce--EEEecc-----CCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCcee
Q 002446 388 NVGMVIVRDI-VSKNV--IAQFRA-----HKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYV 458 (921)
Q Consensus 388 ~~G~V~IwDl-~s~~~--l~~~~a-----H~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~ 458 (921)
....|+|+|+ ..|+. +..... ..+-|+|++|+| +.++||.++.-.+ +-|+.-... .
T Consensus 177 ykrcirvFdt~RpGr~c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gsY~q~-~giy~~~~~--------------~ 241 (406)
T KOG2919|consen 177 YKRCIRVFDTSRPGRDCPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGSYGQR-VGIYNDDGR--------------R 241 (406)
T ss_pred ccceEEEeeccCCCCCCcchhhhhcccccccceeeeeeccCCCCcceeeecccce-eeeEecCCC--------------C
Confidence 3456888887 33332 111122 367799999999 5668998887644 677765543 3
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeC-CCcEEEEecCCCCCce-eecCCCCCcc
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSS-RGTSHLFAINPLGGSV-NFQPTDANFT 515 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~~g~~~-~l~~H~~~~~ 515 (921)
.++.|. |+.. -|+-+.|.+||+.|.+|+. |-.|-.|||...+.++ .+..|.+.++
T Consensus 242 pl~llg-gh~g-GvThL~~~edGn~lfsGaRk~dkIl~WDiR~~~~pv~~L~rhv~~TN 298 (406)
T KOG2919|consen 242 PLQLLG-GHGG-GVTHLQWCEDGNKLFSGARKDDKILCWDIRYSRDPVYALERHVGDTN 298 (406)
T ss_pred ceeeec-ccCC-CeeeEEeccCcCeecccccCCCeEEEEeehhccchhhhhhhhccCcc
Confidence 445553 5443 3999999999999999886 6689999999877664 7788865443
No 232
>PRK04792 tolB translocation protein TolB; Provisional
Probab=97.85 E-value=0.0011 Score=77.64 Aligned_cols=92 Identities=18% Similarity=0.302 Sum_probs=58.3
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEE--eCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIF--KIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIW--di~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.|.++|+.+++. ..+..|.......+|+|||+.|+..+..+....|| |+.++ ....+ ++ .+..
T Consensus 287 ~Iy~~dl~tg~~-~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g------------~~~~L-t~-~g~~ 351 (448)
T PRK04792 287 EIYVVDIATKAL-TRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASG------------KVSRL-TF-EGEQ 351 (448)
T ss_pred EEEEEECCCCCe-EECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCC------------CEEEE-ec-CCCC
Confidence 588889887764 45555666677889999999988776543224455 55443 11222 11 2221
Q ss_pred cccEEEEEEccCCCEEEEEeC-CCcEEEEecCC
Q 002446 469 NAVIQDISFSDDSNWIMISSS-RGTSHLFAINP 500 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~ 500 (921)
....+|||||++|+..+. ++..+||-+..
T Consensus 352 ---~~~~~~SpDG~~l~~~~~~~g~~~I~~~dl 381 (448)
T PRK04792 352 ---NLGGSITPDGRSMIMVNRTNGKFNIARQDL 381 (448)
T ss_pred ---CcCeeECCCCCEEEEEEecCCceEEEEEEC
Confidence 345799999999988765 45566665543
No 233
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=97.84 E-value=5.1e-05 Score=92.87 Aligned_cols=94 Identities=17% Similarity=0.196 Sum_probs=75.2
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.-|.|.+|+....+.-..+.+|.+.|-++.|+-||+++||+|+|-+ ||+|++.+..... ... -||
T Consensus 153 v~~~iivW~~~~dn~p~~l~GHeG~iF~i~~s~dg~~i~s~SdDRs-iRlW~i~s~~~~~-------------~~~-fgH 217 (967)
T KOG0974|consen 153 VFGEIIVWKPHEDNKPIRLKGHEGSIFSIVTSLDGRYIASVSDDRS-IRLWPIDSREVLG-------------CTG-FGH 217 (967)
T ss_pred ccccEEEEeccccCCcceecccCCceEEEEEccCCcEEEEEecCcc-eeeeecccccccC-------------ccc-ccc
Confidence 3478999998744433368899999999999999999999999965 9999999861110 011 244
Q ss_pred ccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+|+|+.++|.|. .+++++.|-|.++|+.+
T Consensus 218 -saRvw~~~~~~n--~i~t~gedctcrvW~~~ 246 (967)
T KOG0974|consen 218 -SARVWACCFLPN--RIITVGEDCTCRVWGVN 246 (967)
T ss_pred -cceeEEEEeccc--eeEEeccceEEEEEecc
Confidence 578999999999 99999999999999543
No 234
>PRK04043 tolB translocation protein TolB; Provisional
Probab=97.80 E-value=0.021 Score=66.59 Aligned_cols=50 Identities=12% Similarity=0.140 Sum_probs=37.7
Q ss_pred EEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEeC----CEEEEEECCCCcE
Q 002446 207 VVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQA----AQVHCFDAATLEI 256 (921)
Q Consensus 207 tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~d----~~I~IwDl~T~~~ 256 (921)
.|.++|+.+|+......++..+....++ ++.|++... ..|+++|+.+++.
T Consensus 214 ~Iyv~dl~tg~~~~lt~~~g~~~~~~~SPDG~~la~~~~~~g~~~Iy~~dl~~g~~ 269 (419)
T PRK04043 214 TLYKYNLYTGKKEKIASSQGMLVVSDVSKDGSKLLLTMAPKGQPDIYLYDTNTKTL 269 (419)
T ss_pred EEEEEECCCCcEEEEecCCCcEEeeEECCCCCEEEEEEccCCCcEEEEEECCCCcE
Confidence 5899999999877766777777777786 456665432 4899999988763
No 235
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.78 E-value=0.0005 Score=80.27 Aligned_cols=111 Identities=9% Similarity=0.116 Sum_probs=92.1
Q ss_pred cCCCCEEEEEECCCCceEEEec--cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFR--AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~--aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+...|.|.+|++..+++-..|. .|.++|.++..+.+-..|-+++.|++ +-.|+.... .++...
T Consensus 76 gt~~g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~-v~~~~~~~~--------------~~~~~~ 140 (541)
T KOG4547|consen 76 GTPQGSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLK-VVYILEKEK--------------VIIRIW 140 (541)
T ss_pred ecCCccEEEEEecCCeEEEEEecCCCCCcceeeecccccCceEecCCcee-EEEEecccc--------------eeeeee
Confidence 3456899999999999988887 89999999999999999999999987 889998874 343333
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcc
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFT 515 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~ 515 (921)
. +.+ -.+.+++.+|||+.++++| ++|++||+++..-...|.+|.+.+.
T Consensus 141 ~-~~~-~~~~sl~is~D~~~l~~as--~~ik~~~~~~kevv~~ftgh~s~v~ 188 (541)
T KOG4547|consen 141 K-EQK-PLVSSLCISPDGKILLTAS--RQIKVLDIETKEVVITFTGHGSPVR 188 (541)
T ss_pred c-cCC-CccceEEEcCCCCEEEecc--ceEEEEEccCceEEEEecCCCcceE
Confidence 2 222 3489999999999999997 5899999999888889999977654
No 236
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=97.77 E-value=8.6e-05 Score=56.38 Aligned_cols=37 Identities=30% Similarity=0.516 Sum_probs=30.9
Q ss_pred EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 459 HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 459 ~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
.+.++ +|+. ..|++|+|+|++++||+++.|++|+|||
T Consensus 3 ~~~~~-~~h~-~~i~~i~~~~~~~~~~s~~~D~~i~vwd 39 (39)
T PF00400_consen 3 CVRTF-RGHS-SSINSIAWSPDGNFLASGSSDGTIRVWD 39 (39)
T ss_dssp EEEEE-ESSS-SSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred EEEEE-cCCC-CcEEEEEEecccccceeeCCCCEEEEEC
Confidence 34455 4654 3599999999999999999999999997
No 237
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=97.77 E-value=6.8e-05 Score=83.11 Aligned_cols=77 Identities=23% Similarity=0.391 Sum_probs=62.8
Q ss_pred eccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEE
Q 002446 406 FRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIM 485 (921)
Q Consensus 406 ~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LA 485 (921)
-++| .+|++|++++||+.|+|||.+...|.|||..++ ....+. .+|.. -+.-+.|||||.+|.
T Consensus 192 ~pgh-~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg------------~~~pL~--~~glg--g~slLkwSPdgd~lf 254 (445)
T KOG2139|consen 192 DPGH-NPVTSMQWNEDGTILVTASFGSSSIMIWDPDTG------------QKIPLI--PKGLG--GFSLLKWSPDGDVLF 254 (445)
T ss_pred CCCC-ceeeEEEEcCCCCEEeecccCcceEEEEcCCCC------------Cccccc--ccCCC--ceeeEEEcCCCCEEE
Confidence 3466 699999999999999999998888999999987 222332 23322 378899999999999
Q ss_pred EEeCCCcEEEEecC
Q 002446 486 ISSSRGTSHLFAIN 499 (921)
Q Consensus 486 sgS~DgTVhVWdi~ 499 (921)
.++-|++.+||..+
T Consensus 255 aAt~davfrlw~e~ 268 (445)
T KOG2139|consen 255 AATCDAVFRLWQEN 268 (445)
T ss_pred Eecccceeeeehhc
Confidence 99999999999654
No 238
>KOG4415 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.74 E-value=1.6e-05 Score=80.83 Aligned_cols=32 Identities=22% Similarity=0.457 Sum_probs=29.9
Q ss_pred eeeeeeEEeecCC-CcccccCCeeEEEEeecCc
Q 002446 724 LYISEAELQMHPP-RIPLWAKPQIYFQSMMIKD 755 (921)
Q Consensus 724 ~ylSnaEvq~h~~-~~plW~~~qi~F~~m~~~~ 755 (921)
.||++|||.||.+ ||+|||+|||.|+.+...+
T Consensus 28 eWl~hVEi~Th~gPHRriWmGPQFef~eih~d~ 60 (247)
T KOG4415|consen 28 EWLPHVEIRTHLGPHRRIWMGPQFEFFEIHEDD 60 (247)
T ss_pred ccccceEEEeccCccceeeecCceeEEEecCCC
Confidence 7999999999999 9999999999999998654
No 239
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.71 E-value=0.0044 Score=77.61 Aligned_cols=108 Identities=15% Similarity=0.194 Sum_probs=66.5
Q ss_pred CCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCC---CEEEEEec-CCCEEEEEeCCCCCC----CCC-CccCCCCce
Q 002446 388 NVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSG---ILLVTASV-QGHNINIFKIIPGIL----GTS-SACDAGTSY 457 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdG---tlLATaS~-DGt~IrIWdi~~g~~----~~~-s~~~~~~~~ 457 (921)
..|++.+||+.=+.++.... +|..+|..|+..|-- ...++++. -.+-+-+|++.++.. +.+ .+. .
T Consensus 1215 s~G~l~lWDLRF~~~i~sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~~~~nevs~wn~~~g~~~~vl~~s~~~p----~- 1289 (1431)
T KOG1240|consen 1215 SRGQLVLWDLRFRVPILSWEHPARAPIRHVWLCPTYPQESVSVSAGSSSNNEVSTWNMETGLRQTVLWASDGAP----I- 1289 (1431)
T ss_pred CCceEEEEEeecCceeecccCcccCCcceEEeeccCCCCceEEEecccCCCceeeeecccCcceEEEEcCCCCc----c-
Confidence 35789999999888887766 556889888877742 46666655 233489999988721 000 000 0
Q ss_pred eEEEEEe----c-ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 458 VHLYRLQ----R-GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 458 ~~l~~l~----R-G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
.-+.+. | -..-+ ....++.--+.++.+|+.|+.|+.||.....
T Consensus 1290 -ls~~~Ps~~~~kp~~~~-~~~~~~~~~~~~~ltggsd~kIR~wD~~~p~ 1337 (1431)
T KOG1240|consen 1290 -LSYALPSNDARKPDSLA-GISCGVCEKNGFLLTGGSDMKIRKWDPTRPE 1337 (1431)
T ss_pred -hhhhcccccCCCCCccc-ceeeecccCCceeeecCCccceeeccCCCcc
Confidence 000000 0 00111 2334565667789999999999999997653
No 240
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=97.71 E-value=0.00039 Score=80.89 Aligned_cols=188 Identities=16% Similarity=0.246 Sum_probs=124.4
Q ss_pred EEEEEECCCCcEEEEEeCC-CCEEEEEEc--CCEEEEE-eCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCccccce
Q 002446 207 VVHFYSLRSQSYVHMLKFR-SPIYSVRCS--SRVVAIC-QAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPL 282 (921)
Q Consensus 207 tVrIWDL~Tg~~V~tL~f~-s~V~sV~~S--~riLAVa-~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~pi 282 (921)
.|.-.+|..|..+..++.. +.+..|.+| ..+||++ .++.|.+||.++-....+|.....+...|+. + -
T Consensus 156 evYRlNLEqGrfL~P~~~~~~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l~~~~~v~s~pg~-------~-~ 227 (703)
T KOG2321|consen 156 EVYRLNLEQGRFLNPFETDSGELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTLDAASSVNSHPGG-------D-A 227 (703)
T ss_pred ceEEEEccccccccccccccccceeeeecCccceEEecccCceEEEecchhhhhheeeecccccCCCccc-------c-c
Confidence 4666699999999988875 688888888 4788884 4889999999988776666532221111100 0 0
Q ss_pred eecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCC
Q 002446 283 AVGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDS 362 (921)
Q Consensus 283 AlgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~ 362 (921)
+.++.-|.|..+
T Consensus 228 ~~svTal~F~d~-------------------------------------------------------------------- 239 (703)
T KOG2321|consen 228 APSVTALKFRDD-------------------------------------------------------------------- 239 (703)
T ss_pred cCcceEEEecCC--------------------------------------------------------------------
Confidence 000001111100
Q ss_pred cCCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCC--CCeEEEEECCCC--CEEEEEecCCCEEEEE
Q 002446 363 QNSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHK--SPISALCFDPSG--ILLVTASVQGHNINIF 438 (921)
Q Consensus 363 ~~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~--~pIsaLaFSPdG--tlLATaS~DGt~IrIW 438 (921)
|+ +++-+...|.|.|||+.+.+++ ..+.|. -||..+.|.+.+ ..|+| .|.++++||
T Consensus 240 --------------gL---~~aVGts~G~v~iyDLRa~~pl-~~kdh~~e~pi~~l~~~~~~~q~~v~S--~Dk~~~kiW 299 (703)
T KOG2321|consen 240 --------------GL---HVAVGTSTGSVLIYDLRASKPL-LVKDHGYELPIKKLDWQDTDQQNKVVS--MDKRILKIW 299 (703)
T ss_pred --------------ce---eEEeeccCCcEEEEEcccCCce-eecccCCccceeeecccccCCCceEEe--cchHHhhhc
Confidence 00 1222345689999999998876 345554 689999998874 45555 455679999
Q ss_pred eCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 439 KIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 439 di~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
|-.++. ....+ .....|.++||=|++-+|.++-....++.|=|..-|..+.+
T Consensus 300 d~~~Gk--------------~~asi---Ept~~lND~C~~p~sGm~f~Ane~~~m~~yyiP~LGPaPrW 351 (703)
T KOG2321|consen 300 DECTGK--------------PMASI---EPTSDLNDFCFVPGSGMFFTANESSKMHTYYIPSLGPAPRW 351 (703)
T ss_pred ccccCC--------------ceeec---cccCCcCceeeecCCceEEEecCCCcceeEEccccCCCchh
Confidence 988761 11111 12234999999999999999999999999988777666554
No 241
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=97.70 E-value=0.0027 Score=74.16 Aligned_cols=110 Identities=16% Similarity=0.263 Sum_probs=77.7
Q ss_pred cccCCCCEEEEEECCCCceEEEecc------CCC-----CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccC
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRA------HKS-----PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACD 452 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~a------H~~-----pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~ 452 (921)
+.+..+|.|..||...+..+.++.. |.+ .|++|+|+.||-.++.|...|. +-|||+...
T Consensus 191 a~Gt~~g~VEfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~-v~iyDLRa~--------- 260 (703)
T KOG2321|consen 191 ACGTEDGVVEFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGS-VLIYDLRAS--------- 260 (703)
T ss_pred EecccCceEEEecchhhhhheeeecccccCCCccccccCcceEEEecCCceeEEeeccCCc-EEEEEcccC---------
Confidence 3345678999999998877666653 333 4999999999999999999998 899999874
Q ss_pred CCCceeEEEEEecccccccEEEEEEccC-CCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 453 AGTSYVHLYRLQRGLTNAVIQDISFSDD-SNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 453 ~~~~~~~l~~l~RG~t~a~I~sIaFSPD-g~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
..+..-..+ ..-+|..+.|-+. .+--+++.+..+++|||-.++.....+..
T Consensus 261 -----~pl~~kdh~-~e~pi~~l~~~~~~~q~~v~S~Dk~~~kiWd~~~Gk~~asiEp 312 (703)
T KOG2321|consen 261 -----KPLLVKDHG-YELPIKKLDWQDTDQQNKVVSMDKRILKIWDECTGKPMASIEP 312 (703)
T ss_pred -----CceeecccC-CccceeeecccccCCCceEEecchHHhhhcccccCCceeeccc
Confidence 112111112 2235899999664 33333444566899999988877666654
No 242
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=97.67 E-value=5.2e-05 Score=88.79 Aligned_cols=89 Identities=16% Similarity=0.222 Sum_probs=72.2
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
..+.|||...|..+.++++|+..|.|++++.||+++|+++.|. .+.||.-.-. -.|+..|+.
T Consensus 33 ~rlliyD~ndG~llqtLKgHKDtVycVAys~dGkrFASG~aDK-~VI~W~~klE-----------------G~LkYSH~D 94 (1081)
T KOG1538|consen 33 SRLLVYDTSDGTLLQPLKGHKDTVYCVAYAKDGKRFASGSADK-SVIIWTSKLE-----------------GILKYSHND 94 (1081)
T ss_pred CEEEEEeCCCcccccccccccceEEEEEEccCCceeccCCCce-eEEEeccccc-----------------ceeeeccCC
Confidence 5799999999999999999999999999999999999999996 5889975532 123333433
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
.|+|++|.|-+..||+++... .-+|..
T Consensus 95 -~IQCMsFNP~~h~LasCsLsd-FglWS~ 121 (1081)
T KOG1538|consen 95 -AIQCMSFNPITHQLASCSLSD-FGLWSP 121 (1081)
T ss_pred -eeeEeecCchHHHhhhcchhh-ccccCh
Confidence 499999999999999987642 445644
No 243
>PRK01029 tolB translocation protein TolB; Provisional
Probab=97.65 E-value=0.0036 Score=73.04 Aligned_cols=77 Identities=18% Similarity=0.140 Sum_probs=47.5
Q ss_pred CCeEEEEECCCCCEEEEEec-CCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 411 SPISALCFDPSGILLVTASV-QGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~-DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
......+|||||+.||..+. +|+ .+||.+.....+ .....+..+ ...+...+|||||++||..+.
T Consensus 281 ~~~~~p~wSPDG~~Laf~s~~~g~-~~ly~~~~~~~g-----------~~~~~lt~~--~~~~~~p~wSPDG~~Laf~~~ 346 (428)
T PRK01029 281 GTQGNPSFSPDGTRLVFVSNKDGR-PRIYIMQIDPEG-----------QSPRLLTKK--YRNSSCPAWSPDGKKIAFCSV 346 (428)
T ss_pred CCcCCeEECCCCCEEEEEECCCCC-ceEEEEECcccc-----------cceEEeccC--CCCccceeECCCCCEEEEEEc
Confidence 34466899999998887764 554 566654321000 011122111 123678899999999998765
Q ss_pred C---CcEEEEecCCC
Q 002446 490 R---GTSHLFAINPL 501 (921)
Q Consensus 490 D---gTVhVWdi~~~ 501 (921)
+ ..|++||+..+
T Consensus 347 ~~g~~~I~v~dl~~g 361 (428)
T PRK01029 347 IKGVRQICVYDLATG 361 (428)
T ss_pred CCCCcEEEEEECCCC
Confidence 4 35788888654
No 244
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=97.60 E-value=0.00014 Score=81.59 Aligned_cols=103 Identities=16% Similarity=0.148 Sum_probs=76.2
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
+.+..+.+|....+. ...+-+|-+-++.|+|+||++++.||+.|++ |||=...-. .-+..+--|
T Consensus 129 gD~~~~di~s~~~~~-~~~~lGhvSml~dVavS~D~~~IitaDRDEk-IRvs~ypa~--------------f~IesfclG 192 (390)
T KOG3914|consen 129 GDVYSFDILSADSGR-CEPILGHVSMLLDVAVSPDDQFIITADRDEK-IRVSRYPAT--------------FVIESFCLG 192 (390)
T ss_pred CCceeeeeecccccC-cchhhhhhhhhheeeecCCCCEEEEecCCce-EEEEecCcc--------------cchhhhccc
Confidence 344667777766643 3566799999999999999999999999997 888654421 122334446
Q ss_pred cccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
|+. -|..|+.-++ +.|+++|.|+|+++||+..+....++
T Consensus 193 H~e-FVS~isl~~~-~~LlS~sGD~tlr~Wd~~sgk~L~t~ 231 (390)
T KOG3914|consen 193 HKE-FVSTISLTDN-YLLLSGSGDKTLRLWDITSGKLLDTC 231 (390)
T ss_pred cHh-heeeeeeccC-ceeeecCCCCcEEEEecccCCccccc
Confidence 654 3888887654 66999999999999999998776443
No 245
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=97.60 E-value=0.00074 Score=74.38 Aligned_cols=93 Identities=14% Similarity=0.266 Sum_probs=65.0
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC-----------------------------------
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ----------------------------------- 431 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D----------------------------------- 431 (921)
+.+-.|.||.+-+.+.. .++--+..+..++|+|||++.|.++..
T Consensus 111 eF~lriTVWSL~t~~~~-~~~~pK~~~kg~~f~~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPd 189 (447)
T KOG4497|consen 111 EFDLRITVWSLNTQKGY-LLPHPKTNVKGYAFHPDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPD 189 (447)
T ss_pred cceeEEEEEEeccceeE-EecccccCceeEEECCCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCC
Confidence 44567889998877653 333334456788999999998888642
Q ss_pred CCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 432 GHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 432 Gt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
|..+-|||.--. ..+|..+||.. |..++|||.+++||+|+.|+.+||-+
T Consensus 190 g~~laVwd~~Le--------------ykv~aYe~~lG---~k~v~wsP~~qflavGsyD~~lrvln 238 (447)
T KOG4497|consen 190 GNWLAVWDNVLE--------------YKVYAYERGLG---LKFVEWSPCNQFLAVGSYDQMLRVLN 238 (447)
T ss_pred CcEEEEecchhh--------------heeeeeeeccc---eeEEEeccccceEEeeccchhhhhhc
Confidence 333444443221 24556667653 88999999999999999999999854
No 246
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=97.57 E-value=0.014 Score=67.09 Aligned_cols=51 Identities=14% Similarity=0.166 Sum_probs=41.0
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEeCC-EEEEEECCCCcE
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQAA-QVHCFDAATLEI 256 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~d~-~I~IwDl~T~~~ 256 (921)
-.|-|||..+++..+..+-=+.|.+|..+ ++.++|+.++ +|.++|+.++..
T Consensus 382 D~l~iyd~~~~e~kr~e~~lg~I~av~vs~dGK~~vvaNdr~el~vididngnv 435 (668)
T COG4946 382 DKLGIYDKDGGEVKRIEKDLGNIEAVKVSPDGKKVVVANDRFELWVIDIDNGNV 435 (668)
T ss_pred ceEEEEecCCceEEEeeCCccceEEEEEcCCCcEEEEEcCceEEEEEEecCCCe
Confidence 36889999999866655556889999996 5778887665 999999999864
No 247
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=97.56 E-value=0.059 Score=69.81 Aligned_cols=81 Identities=10% Similarity=0.109 Sum_probs=53.2
Q ss_pred EEEEECCCCCEEEEEecCCCEEEEEeCCCCCC----CCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 414 SALCFDPSGILLVTASVQGHNINIFKIIPGIL----GTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 414 saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~----~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
..|+|+++|.++++-+.+++ |++||..++.. +.. ..+.. .... + .+. -.....|++++||+.+++-+.
T Consensus 807 ~Gvavd~dG~LYVADs~N~r-IrviD~~tg~v~tiaG~G-~~G~~-dG~~---~-~a~-l~~P~GIavd~dG~lyVaDt~ 878 (1057)
T PLN02919 807 LGVLCAKDGQIYVADSYNHK-IKKLDPATKRVTTLAGTG-KAGFK-DGKA---L-KAQ-LSEPAGLALGENGRLFVADTN 878 (1057)
T ss_pred ceeeEeCCCcEEEEECCCCE-EEEEECCCCeEEEEeccC-CcCCC-CCcc---c-ccc-cCCceEEEEeCCCCEEEEECC
Confidence 47899999998777766654 99999876510 000 00000 0000 0 000 013678999999999999999
Q ss_pred CCcEEEEecCCCC
Q 002446 490 RGTSHLFAINPLG 502 (921)
Q Consensus 490 DgTVhVWdi~~~g 502 (921)
+++|++||+.+..
T Consensus 879 Nn~Irvid~~~~~ 891 (1057)
T PLN02919 879 NSLIRYLDLNKGE 891 (1057)
T ss_pred CCEEEEEECCCCc
Confidence 9999999998753
No 248
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.55 E-value=0.0069 Score=71.11 Aligned_cols=97 Identities=21% Similarity=0.346 Sum_probs=76.7
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
+.+.+++|..|+...++.++.+++-+..+.+++.+|||++|++||.. |++||+.+. +.+.+|
T Consensus 119 S~~ad~~v~~~~~~~~~~~~~~~~~~~~~~sl~is~D~~~l~~as~~---ik~~~~~~k--------------evv~~f- 180 (541)
T KOG4547|consen 119 SVGADLKVVYILEKEKVIIRIWKEQKPLVSSLCISPDGKILLTASRQ---IKVLDIETK--------------EVVITF- 180 (541)
T ss_pred ecCCceeEEEEecccceeeeeeccCCCccceEEEcCCCCEEEeccce---EEEEEccCc--------------eEEEEe-
Confidence 44667899999999999999999999999999999999999999853 999999985 333333
Q ss_pred cccccccEEEEEEccC-----CCEEEEE-eCCCcEEEEecCC
Q 002446 465 RGLTNAVIQDISFSDD-----SNWIMIS-SSRGTSHLFAINP 500 (921)
Q Consensus 465 RG~t~a~I~sIaFSPD-----g~~LAsg-S~DgTVhVWdi~~ 500 (921)
.|| ...|.+++|--+ |+||.++ -.+.-+-+|-+..
T Consensus 181 tgh-~s~v~t~~f~~~~~g~~G~~vLssa~~~r~i~~w~v~~ 221 (541)
T KOG4547|consen 181 TGH-GSPVRTLSFTTLIDGIIGKYVLSSAAAERGITVWVVEK 221 (541)
T ss_pred cCC-CcceEEEEEEEeccccccceeeeccccccceeEEEEEc
Confidence 565 456999999877 6666543 3455567777655
No 249
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=97.55 E-value=0.00086 Score=82.54 Aligned_cols=101 Identities=17% Similarity=0.209 Sum_probs=80.4
Q ss_pred ccCCCCEEEEEECCCCceEE-EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 385 DADNVGMVIVRDIVSKNVIA-QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~-~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+...|..+++|++++.+.+. +.=+|+..|..++|.|+ +|+|++.|-| .++|+..-. ....|+-
T Consensus 192 s~SdDRsiRlW~i~s~~~~~~~~fgHsaRvw~~~~~~n--~i~t~gedct-crvW~~~~~-------------~l~~y~~ 255 (967)
T KOG0974|consen 192 SVSDDRSIRLWPIDSREVLGCTGFGHSARVWACCFLPN--RIITVGEDCT-CRVWGVNGT-------------QLEVYDE 255 (967)
T ss_pred EEecCcceeeeecccccccCcccccccceeEEEEeccc--eeEEeccceE-EEEEecccc-------------eehhhhh
Confidence 34567889999999988766 56699999999999999 9999999976 899965432 1223443
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
++| .-|+.++..++..++.+++.|+++++|++..-+..
T Consensus 256 h~g---~~iw~~~~~~~~~~~vT~g~Ds~lk~~~l~~r~~e 293 (967)
T KOG0974|consen 256 HSG---KGIWKIAVPIGVIIKVTGGNDSTLKLWDLNGRGLE 293 (967)
T ss_pred hhh---cceeEEEEcCCceEEEeeccCcchhhhhhhccccc
Confidence 333 34999999999999999999999999999765443
No 250
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.55 E-value=0.053 Score=61.32 Aligned_cols=54 Identities=19% Similarity=0.323 Sum_probs=38.1
Q ss_pred CCEEEEEECC--CC--ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCC
Q 002446 389 VGMVIVRDIV--SK--NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 389 ~G~V~IwDl~--s~--~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~ 442 (921)
...|.+|++. ++ +.+..+.....--..++|+|||++|+.+..+...|.+|++..
T Consensus 266 ~~sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~s~~g~~l~Va~~~s~~v~vf~~d~ 323 (345)
T PF10282_consen 266 SNSISVFDLDPATGTLTLVQTVPTGGKFPRHFAFSPDGRYLYVANQDSNTVSVFDIDP 323 (345)
T ss_dssp TTEEEEEEECTTTTTEEEEEEEEESSSSEEEEEE-TTSSEEEEEETTTTEEEEEEEET
T ss_pred CCEEEEEEEecCCCceEEEEEEeCCCCCccEEEEeCCCCEEEEEecCCCeEEEEEEeC
Confidence 4567888873 23 334444443344688999999999999998887899998864
No 251
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.53 E-value=0.0016 Score=81.36 Aligned_cols=96 Identities=14% Similarity=0.284 Sum_probs=73.6
Q ss_pred EECCCCceEEEeccCCCCeEEEEECCCC-CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 395 RDIVSKNVIAQFRAHKSPISALCFDPSG-ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 395 wDl~s~~~l~~~~aH~~pIsaLaFSPdG-tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
|.. .|..++++..|...|..++.++.- .+++|||.||+ ||||++..- .+... .....+.|.. ...++.
T Consensus 1034 W~p-~G~lVAhL~Ehs~~v~k~a~s~~~~s~FvsgS~DGt-VKvW~~~k~-~~~~~----s~rS~ltys~----~~sr~~ 1102 (1431)
T KOG1240|consen 1034 WNP-RGILVAHLHEHSSAVIKLAVSSEHTSLFVSGSDDGT-VKVWNLRKL-EGEGG----SARSELTYSP----EGSRVE 1102 (1431)
T ss_pred CCc-cceEeehhhhccccccceeecCCCCceEEEecCCce-EEEeeehhh-hcCcc----eeeeeEEEec----cCCceE
Confidence 443 367889999999999999888764 99999999998 999999864 11100 0112333333 223589
Q ss_pred EEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 474 DISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.+.+.+.|..+|+++.||.|+++++..+
T Consensus 1103 ~vt~~~~~~~~Av~t~DG~v~~~~id~~ 1130 (1431)
T KOG1240|consen 1103 KVTMCGNGDQFAVSTKDGSVRVLRIDHY 1130 (1431)
T ss_pred EEEeccCCCeEEEEcCCCeEEEEEcccc
Confidence 9999999999999999999999999886
No 252
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=97.51 E-value=0.0081 Score=66.82 Aligned_cols=80 Identities=16% Similarity=0.213 Sum_probs=56.0
Q ss_pred CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec-----------ccccccEEEEEE
Q 002446 409 HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR-----------GLTNAVIQDISF 477 (921)
Q Consensus 409 H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R-----------G~t~a~I~sIaF 477 (921)
--+.|+.++|+++|+|++|-+.- + ++|||+... ..+ ...|.++. ...-..=..++|
T Consensus 271 iIsSISDvKFs~sGryilsRDyl-t-vk~wD~nme-~~p----------v~t~~vh~~lr~kLc~lYEnD~IfdKFec~~ 337 (433)
T KOG1354|consen 271 IISSISDVKFSHSGRYILSRDYL-T-VKLWDLNME-AKP----------VETYPVHEYLRSKLCSLYENDAIFDKFECSW 337 (433)
T ss_pred HhhhhhceEEccCCcEEEEeccc-e-eEEEecccc-CCc----------ceEEeehHhHHHHHHHHhhccchhheeEEEE
Confidence 34689999999999999997665 4 999999543 100 11122110 000011246899
Q ss_pred ccCCCEEEEEeCCCcEEEEecCCC
Q 002446 478 SDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 478 SPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|-|+.++++||-..-+|||++..+
T Consensus 338 sg~~~~v~TGsy~n~frvf~~~~g 361 (433)
T KOG1354|consen 338 SGNDSYVMTGSYNNVFRVFNLARG 361 (433)
T ss_pred cCCcceEecccccceEEEecCCCC
Confidence 999999999999999999997664
No 253
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=97.49 E-value=0.033 Score=58.24 Aligned_cols=91 Identities=15% Similarity=0.245 Sum_probs=61.0
Q ss_pred CCEEEEEECCCCceEEEeccCCCC----------e-EEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSP----------I-SALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~p----------I-saLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
.|.|..+|+.+|+.+.....+..+ + ..+.++ +| .+..++.+|..+.+ |+.++
T Consensus 131 ~g~l~~~d~~tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~-~~-~v~~~~~~g~~~~~-d~~tg-------------- 193 (238)
T PF13360_consen 131 SGKLVALDPKTGKLLWKYPVGEPRGSSPISSFSDINGSPVIS-DG-RVYVSSGDGRVVAV-DLATG-------------- 193 (238)
T ss_dssp CSEEEEEETTTTEEEEEEESSTT-SS--EEEETTEEEEEECC-TT-EEEEECCTSSEEEE-ETTTT--------------
T ss_pred cCcEEEEecCCCcEEEEeecCCCCCCcceeeecccccceEEE-CC-EEEEEcCCCeEEEE-ECCCC--------------
Confidence 578899999999988888765432 1 233344 55 66666777765667 99886
Q ss_pred eEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 458 VHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
..+++.. ... +.. ....++..|.+++.+++++.||+.++
T Consensus 194 ~~~w~~~--~~~--~~~-~~~~~~~~l~~~~~~~~l~~~d~~tG 232 (238)
T PF13360_consen 194 EKLWSKP--ISG--IYS-LPSVDGGTLYVTSSDGRLYALDLKTG 232 (238)
T ss_dssp EEEEEEC--SS---ECE-CEECCCTEEEEEETTTEEEEEETTTT
T ss_pred CEEEEec--CCC--ccC-CceeeCCEEEEEeCCCEEEEEECCCC
Confidence 3344322 111 222 25678888888889999999999885
No 254
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.45 E-value=0.063 Score=60.92 Aligned_cols=103 Identities=13% Similarity=0.130 Sum_probs=64.8
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
...+|.+..||..+++.+...... ..... ..++..|..++.+|. +..+|..++ ..+++...
T Consensus 247 ~~~~g~l~a~d~~tG~~~W~~~~~--~~~~p--~~~~~~vyv~~~~G~-l~~~d~~tG--------------~~~W~~~~ 307 (377)
T TIGR03300 247 VSYQGRVAALDLRSGRVLWKRDAS--SYQGP--AVDDNRLYVTDADGV-VVALDRRSG--------------SELWKNDE 307 (377)
T ss_pred EEcCCEEEEEECCCCcEEEeeccC--CccCc--eEeCCEEEEECCCCe-EEEEECCCC--------------cEEEcccc
Confidence 345789999999999887766521 11122 235667777788886 899999876 33444321
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPT 510 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H 510 (921)
.......+... .+..|.+++.+|.+++||..++...-.+..|
T Consensus 308 -~~~~~~ssp~i--~g~~l~~~~~~G~l~~~d~~tG~~~~~~~~~ 349 (377)
T TIGR03300 308 -LKYRQLTAPAV--VGGYLVVGDFEGYLHWLSREDGSFVARLKTD 349 (377)
T ss_pred -ccCCccccCEE--ECCEEEEEeCCCEEEEEECCCCCEEEEEEcC
Confidence 00111111122 4678999999999999998776444444444
No 255
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=97.45 E-value=0.0017 Score=74.67 Aligned_cols=122 Identities=16% Similarity=0.143 Sum_probs=77.9
Q ss_pred CCCCCCCcEEEEEEecccCCCCCCCeEEEEEccC-cEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCcccc
Q 002446 83 DDESSHDQVLWAGFDKLESEAGATRRVLLLGYRS-GFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAE 161 (921)
Q Consensus 83 ~~~~~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~-GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~ 161 (921)
..+.|+.-|.-+-|++ .| .+|+.|.+. .+.|||-....-.....|.|...|.-.+|+|. .+
T Consensus 137 kL~~H~GcVntV~FN~---~G----d~l~SgSDD~~vv~WdW~~~~~~l~f~SGH~~NvfQaKFiP~-----------s~ 198 (559)
T KOG1334|consen 137 KLNKHKGCVNTVHFNQ---RG----DVLASGSDDLQVVVWDWVSGSPKLSFESGHCNNVFQAKFIPF-----------SG 198 (559)
T ss_pred cccCCCCccceeeecc---cC----ceeeccCccceEEeehhhccCcccccccccccchhhhhccCC-----------CC
Confidence 5568899999999999 66 588888765 57999998754444456788878887788763 34
Q ss_pred CCCEEEEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEEC-CCCcEEEEE---eCCCCEEEEEE---c
Q 002446 162 VRPLLVFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSL-RSQSYVHML---KFRSPIYSVRC---S 234 (921)
Q Consensus 162 ~rPLLAvv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL-~Tg~~V~tL---~f~s~V~sV~~---S 234 (921)
.++++. |+. | +.||+=.+ .++.+..+. ++..+|.-++. +
T Consensus 199 d~ti~~-~s~----------d-----------------------gqvr~s~i~~t~~~e~t~rl~~h~g~vhklav~p~s 244 (559)
T KOG1334|consen 199 DRTIVT-SSR----------D-----------------------GQVRVSEILETGYVENTKRLAPHEGPVHKLAVEPDS 244 (559)
T ss_pred CcCcee-ccc----------c-----------------------CceeeeeeccccceecceecccccCccceeeecCCC
Confidence 455442 221 2 22333322 233333222 35677777777 3
Q ss_pred CC-EEEEEeCCEEEEEECCCCcE
Q 002446 235 SR-VVAICQAAQVHCFDAATLEI 256 (921)
Q Consensus 235 ~r-iLAVa~d~~I~IwDl~T~~~ 256 (921)
++ ++..+.++.+.-+|+++...
T Consensus 245 p~~f~S~geD~~v~~~Dlr~~~p 267 (559)
T KOG1334|consen 245 PKPFLSCGEDAVVFHIDLRQDVP 267 (559)
T ss_pred CCcccccccccceeeeeeccCCc
Confidence 44 44457778888899887653
No 256
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=97.43 E-value=0.00096 Score=74.61 Aligned_cols=107 Identities=12% Similarity=0.116 Sum_probs=84.3
Q ss_pred ccccCCCCEEEEEECC------CCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 383 FPDADNVGMVIVRDIV------SKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~------s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
+++++.+-.++||.+. +.+++.... .|.+.|-||+|+-..++|.++..+|+ +..-|+.+.
T Consensus 71 L~SGGDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~-VI~HDiEt~------------ 137 (609)
T KOG4227|consen 71 LASGGDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGT-VIKHDIETK------------ 137 (609)
T ss_pred EeecCCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcce-eEeeecccc------------
Confidence 4567788899999985 345665555 45589999999999999999999998 678899874
Q ss_pred ceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 456 SYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
..+|.+........|+.+.-+|-.+.|++.+.++-|-+||+......
T Consensus 138 --qsi~V~~~~~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~~~~ 184 (609)
T KOG4227|consen 138 --QSIYVANENNNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDRQNP 184 (609)
T ss_pred --eeeeeecccCcccceeecccCCCCceEEEEecCceEEEEeccCCCCC
Confidence 44555533333335999999999999999999999999999875433
No 257
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.42 E-value=0.00015 Score=82.61 Aligned_cols=107 Identities=10% Similarity=0.271 Sum_probs=89.1
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
+++++..|.++.-|+.+|+.++.|..-.+++..|+-+|-...+-+|-..|+ |.+|.-... ..|.+
T Consensus 224 L~~~~~~G~L~Y~DVS~GklVa~~~t~~G~~~vm~qNP~NaVih~GhsnGt-VSlWSP~sk--------------ePLvK 288 (545)
T KOG1272|consen 224 LVAASEAGFLKYQDVSTGKLVASIRTGAGRTDVMKQNPYNAVIHLGHSNGT-VSLWSPNSK--------------EPLVK 288 (545)
T ss_pred eeecccCCceEEEeechhhhhHHHHccCCccchhhcCCccceEEEcCCCce-EEecCCCCc--------------chHHH
Confidence 346677899999999999999999999999999999999999999999998 899975542 12222
Q ss_pred E--ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 463 L--QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 463 l--~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
+ +|| .|.+||+.++|+|+||++.|..++|||+..+....+++
T Consensus 289 iLcH~g----~V~siAv~~~G~YMaTtG~Dr~~kIWDlR~~~ql~t~~ 332 (545)
T KOG1272|consen 289 ILCHRG----PVSSIAVDRGGRYMATTGLDRKVKIWDLRNFYQLHTYR 332 (545)
T ss_pred HHhcCC----CcceEEECCCCcEEeecccccceeEeeeccccccceee
Confidence 2 333 48999999999999999999999999999887555543
No 258
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=97.39 E-value=0.00065 Score=72.29 Aligned_cols=80 Identities=20% Similarity=0.272 Sum_probs=64.2
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCC
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRG 491 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~Dg 491 (921)
.|++|-.+|...-|.+|+.|+. |.-||++++ .+.+..|||+.. |.+++--.-+..+.+|+.||
T Consensus 116 eINam~ldP~enSi~~AgGD~~-~y~~dlE~G---------------~i~r~~rGHtDY-vH~vv~R~~~~qilsG~EDG 178 (325)
T KOG0649|consen 116 EINAMWLDPSENSILFAGGDGV-IYQVDLEDG---------------RIQREYRGHTDY-VHSVVGRNANGQILSGAEDG 178 (325)
T ss_pred ccceeEeccCCCcEEEecCCeE-EEEEEecCC---------------EEEEEEcCCcce-eeeeeecccCcceeecCCCc
Confidence 6899999998888888888985 899999987 344556898865 88998844445577999999
Q ss_pred cEEEEecCCCCCceeec
Q 002446 492 TSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 492 TVhVWdi~~~g~~~~l~ 508 (921)
|+||||..+.+....+.
T Consensus 179 tvRvWd~kt~k~v~~ie 195 (325)
T KOG0649|consen 179 TVRVWDTKTQKHVSMIE 195 (325)
T ss_pred cEEEEeccccceeEEec
Confidence 99999999876665553
No 259
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=97.37 E-value=0.00047 Score=79.78 Aligned_cols=111 Identities=14% Similarity=0.168 Sum_probs=82.6
Q ss_pred ccccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECC--CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDP--SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSP--dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
++++..|-.+.|||.-..+++..+. +|+..|-+++|=| +.++++||+.|. .|+|||+.....+. ......
T Consensus 65 L~SGSDD~r~ivWd~~~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk-~i~lfdl~~~~~~~------~d~~~~ 137 (758)
T KOG1310|consen 65 LASGSDDTRLIVWDPFEYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDK-LIKLFDLDSSKEGG------MDHGME 137 (758)
T ss_pred EeecCCcceEEeecchhcceeeeeecccccceeEEeeeccCCCeEEEeccCcc-eEEEEecccccccc------cccCcc
Confidence 4577788899999999999988887 9999999999999 578999999996 59999998531000 000000
Q ss_pred EEEEecccccccEEEEEEccCC-CEEEEEeCCCcEEEEecCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDS-NWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg-~~LAsgS~DgTVhVWdi~~ 500 (921)
.-..-.+-+..+|..|+-.|++ .-|-+++.|||++-+|+..
T Consensus 138 ~~~~~~~cht~rVKria~~p~~PhtfwsasEDGtirQyDiRE 179 (758)
T KOG1310|consen 138 ETTRCWSCHTDRVKRIATAPNGPHTFWSASEDGTIRQYDIRE 179 (758)
T ss_pred chhhhhhhhhhhhhheecCCCCCceEEEecCCcceeeecccC
Confidence 0000112223357889999999 7788999999999999976
No 260
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=97.32 E-value=0.00032 Score=80.98 Aligned_cols=115 Identities=20% Similarity=0.192 Sum_probs=79.9
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCC------C---------C
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGI------L---------G 446 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~------~---------~ 446 (921)
+++-+.+||.+.|.. .++++...+.+|.++|.|-.|+|||+-|+|+++||- |+||.-.--. . +
T Consensus 77 ~~~i~s~DGkf~il~-k~~rVE~sv~AH~~A~~~gRW~~dGtgLlt~GEDG~-iKiWSrsGMLRStl~Q~~~~v~c~~W~ 154 (737)
T KOG1524|consen 77 TLLICSNDGRFVILN-KSARVERSISAHAAAISSGRWSPDGAGLLTAGEDGV-IKIWSRSGMLRSTVVQNEESIRCARWA 154 (737)
T ss_pred eEEEEcCCceEEEec-ccchhhhhhhhhhhhhhhcccCCCCceeeeecCCce-EEEEeccchHHHHHhhcCceeEEEEEC
Confidence 445567789888876 456777889999999999999999999999999996 9999643210 0 1
Q ss_pred CCCccCCCCceeEEE---------EEecccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 447 TSSACDAGTSYVHLY---------RLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 447 ~~s~~~~~~~~~~l~---------~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
+.|..-....+.|++ .+++.-+..-|.++.|++.+..+++|+.|-..+|||-
T Consensus 155 p~S~~vl~c~g~h~~IKpL~~n~k~i~WkAHDGiiL~~~W~~~s~lI~sgGED~kfKvWD~ 215 (737)
T KOG1524|consen 155 PNSNSIVFCQGGHISIKPLAANSKIIRWRAHDGLVLSLSWSTQSNIIASGGEDFRFKIWDA 215 (737)
T ss_pred CCCCceEEecCCeEEEeecccccceeEEeccCcEEEEeecCccccceeecCCceeEEeecc
Confidence 111000000011111 1122223345999999999999999999999999995
No 261
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=97.31 E-value=0.004 Score=71.40 Aligned_cols=104 Identities=19% Similarity=0.284 Sum_probs=77.7
Q ss_pred cCCCC-EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 386 ADNVG-MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 386 ~~~~G-~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
+..+| .+-|||..+++. ..+...-+.|-+|+.+|||++++.|-.... |-+.|+.++ ..+.+-+-+
T Consensus 377 gt~dgD~l~iyd~~~~e~-kr~e~~lg~I~av~vs~dGK~~vvaNdr~e-l~vididng------------nv~~idkS~ 442 (668)
T COG4946 377 GTNDGDKLGIYDKDGGEV-KRIEKDLGNIEAVKVSPDGKKVVVANDRFE-LWVIDIDNG------------NVRLIDKSE 442 (668)
T ss_pred eccCCceEEEEecCCceE-EEeeCCccceEEEEEcCCCcEEEEEcCceE-EEEEEecCC------------CeeEecccc
Confidence 34556 899999998865 566677789999999999999999887765 677788876 233333333
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCC----cEEEEecCCCCCceeec
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRG----TSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~Dg----TVhVWdi~~~g~~~~l~ 508 (921)
.| -|++++|+|+++|||-+=-+| .|||||+... ....+.
T Consensus 443 ~~----lItdf~~~~nsr~iAYafP~gy~tq~Iklydm~~~-Kiy~vT 485 (668)
T COG4946 443 YG----LITDFDWHPNSRWIAYAFPEGYYTQSIKLYDMDGG-KIYDVT 485 (668)
T ss_pred cc----eeEEEEEcCCceeEEEecCcceeeeeEEEEecCCC-eEEEec
Confidence 33 399999999999999876665 6999999663 444443
No 262
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=97.26 E-value=0.0036 Score=68.99 Aligned_cols=100 Identities=13% Similarity=0.100 Sum_probs=76.3
Q ss_pred CCCCEEEEEECCCC---ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 387 DNVGMVIVRDIVSK---NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 387 ~~~G~V~IwDl~s~---~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
.+...|.||..... +..++++.|...|+.|+++|.+..|+||+.|.. -.||....+.. | .....|
T Consensus 29 ~~~~evhiy~~~~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drn-ayVw~~~~~~~-------W----kptlvL 96 (361)
T KOG1523|consen 29 PNNHEVHIYSMLGADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRN-AYVWTQPSGGT-------W----KPTLVL 96 (361)
T ss_pred cCCceEEEEEecCCCCceeceehhhhCcceeEEeecCCCCceeEccCCCC-ccccccCCCCe-------e----ccceeE
Confidence 34457888887664 478899999999999999999999999999965 79998854411 1 111222
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.|- .. ..++|.|||.++.||+||.-..|-||=++.
T Consensus 97 lRi-Nr-AAt~V~WsP~enkFAVgSgar~isVcy~E~ 131 (361)
T KOG1523|consen 97 LRI-NR-AATCVKWSPKENKFAVGSGARLISVCYYEQ 131 (361)
T ss_pred EEe-cc-ceeeEeecCcCceEEeccCccEEEEEEEec
Confidence 232 22 278999999999999999999999987654
No 263
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=97.23 E-value=0.1 Score=61.47 Aligned_cols=100 Identities=13% Similarity=0.251 Sum_probs=72.4
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEec-CCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASV-QGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~-DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
-++++++++...+.-.+. -.+||.+++|+|+|+-++.+-. -=-.+.|||+.- ..++.+-.|-.
T Consensus 251 q~Lyll~t~g~s~~V~L~-k~GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr~---------------~~v~df~egpR 314 (566)
T KOG2315|consen 251 QTLYLLATQGESVSVPLL-KEGPVHDVTWSPSGREFAVVYGFMPAKVTIFNLRG---------------KPVFDFPEGPR 314 (566)
T ss_pred ceEEEEEecCceEEEecC-CCCCceEEEECCCCCEEEEEEecccceEEEEcCCC---------------CEeEeCCCCCc
Confidence 467888887444433333 3689999999999998877531 112378888763 35677765543
Q ss_pred cccEEEEEEccCCCEEEEEeC---CCcEEEEecCCCCCceeecC
Q 002446 469 NAVIQDISFSDDSNWIMISSS---RGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~---DgTVhVWdi~~~g~~~~l~~ 509 (921)
+++-|+|.|++|+.++- .|.+-|||+...+....+..
T Consensus 315 ----N~~~fnp~g~ii~lAGFGNL~G~mEvwDv~n~K~i~~~~a 354 (566)
T KOG2315|consen 315 ----NTAFFNPHGNIILLAGFGNLPGDMEVWDVPNRKLIAKFKA 354 (566)
T ss_pred ----cceEECCCCCEEEEeecCCCCCceEEEeccchhhcccccc
Confidence 46889999999998875 67899999999877766644
No 264
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=97.19 E-value=0.0006 Score=76.18 Aligned_cols=101 Identities=15% Similarity=0.158 Sum_probs=74.2
Q ss_pred EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCC
Q 002446 403 IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSN 482 (921)
Q Consensus 403 l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~ 482 (921)
.+.+.+|.+-|.+|.||.+|++||++++|-+ ++||.+........ .+. ..+...++...|.|++|.-..+
T Consensus 49 qKD~~~H~GCiNAlqFS~N~~~L~SGGDD~~-~~~W~~de~~~~k~--------~KP-I~~~~~~H~SNIF~L~F~~~N~ 118 (609)
T KOG4227|consen 49 QKDVREHTGCINALQFSHNDRFLASGGDDMH-GRVWNVDELMVRKT--------PKP-IGVMEHPHRSNIFSLEFDLENR 118 (609)
T ss_pred hhhhhhhccccceeeeccCCeEEeecCCcce-eeeechHHHHhhcC--------CCC-ceeccCccccceEEEEEccCCe
Confidence 3456799999999999999999999999976 89999875311000 011 1222222335699999999999
Q ss_pred EEEEEeCCCcEEEEecCCCCCceeecCCCCCc
Q 002446 483 WIMISSSRGTSHLFAINPLGGSVNFQPTDANF 514 (921)
Q Consensus 483 ~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~ 514 (921)
+|.+|..++||.+-|+.+. +..-+..|.++-
T Consensus 119 ~~~SG~~~~~VI~HDiEt~-qsi~V~~~~~~~ 149 (609)
T KOG4227|consen 119 FLYSGERWGTVIKHDIETK-QSIYVANENNNR 149 (609)
T ss_pred eEecCCCcceeEeeecccc-eeeeeecccCcc
Confidence 9999999999999999885 344445565543
No 265
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=97.18 E-value=0.0022 Score=75.58 Aligned_cols=91 Identities=15% Similarity=0.204 Sum_probs=69.5
Q ss_pred EEEEECCCCce--EEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 392 VIVRDIVSKNV--IAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 392 V~IwDl~s~~~--l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
-.+|++..+++ ++..+ .+.+.|.+.+++|+.+.|+.|..||. |.+||...+ ..+..+.
T Consensus 238 ~ciYE~~r~klqrvsvtsipL~s~v~~ca~sp~E~kLvlGC~DgS-iiLyD~~~~-------------~t~~~ka----- 298 (545)
T PF11768_consen 238 SCIYECSRNKLQRVSVTSIPLPSQVICCARSPSEDKLVLGCEDGS-IILYDTTRG-------------VTLLAKA----- 298 (545)
T ss_pred EEEEEeecCceeEEEEEEEecCCcceEEecCcccceEEEEecCCe-EEEEEcCCC-------------eeeeeee-----
Confidence 34677765532 22222 67889999999999999999999997 899999875 1111111
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.-....++|+|||..|++|+..|.+.+||+.-.
T Consensus 299 ~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALs 331 (545)
T PF11768_consen 299 EFIPTLIAWHPDGAIFVVGSEQGELQCFDMALS 331 (545)
T ss_pred cccceEEEEcCCCcEEEEEcCCceEEEEEeecC
Confidence 123789999999999999999999999999764
No 266
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=97.18 E-value=0.001 Score=46.80 Aligned_cols=39 Identities=26% Similarity=0.663 Sum_probs=34.8
Q ss_pred CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEe
Q 002446 400 KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFK 439 (921)
Q Consensus 400 ~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWd 439 (921)
++++..+.+|...|.+++|+|++.++++++.||+ +++|+
T Consensus 2 ~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~d~~-~~~~~ 40 (40)
T smart00320 2 GELLKTLKGHTGPVTSVAFSPDGKYLASASDDGT-IKLWD 40 (40)
T ss_pred cEEEEEEEecCCceeEEEECCCCCEEEEecCCCe-EEEcC
Confidence 3566788899999999999999999999999997 89996
No 267
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=97.16 E-value=0.0011 Score=85.08 Aligned_cols=91 Identities=19% Similarity=0.387 Sum_probs=69.0
Q ss_pred CCCEEEEEECCC---CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 388 NVGMVIVRDIVS---KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 388 ~~G~V~IwDl~s---~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
.++.|.+||.-- ...+. .+|.+.+++++|-|.-++|.||+.+|. |.|||+... ..+| +
T Consensus 2313 d~~n~~lwDtl~~~~~s~v~--~~H~~gaT~l~~~P~~qllisggr~G~-v~l~D~rqr------------ql~h--~-- 2373 (2439)
T KOG1064|consen 2313 DNRNVCLWDTLLPPMNSLVH--TCHDGGATVLAYAPKHQLLISGGRKGE-VCLFDIRQR------------QLRH--T-- 2373 (2439)
T ss_pred CCCcccchhcccCcccceee--eecCCCceEEEEcCcceEEEecCCcCc-EEEeehHHH------------HHHH--H--
Confidence 346788898642 23333 899999999999999999999999998 899999863 1111 1
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
++. +. .-.+|.+++.+|+++||+++.++-...+
T Consensus 2374 -------~~~--~~-~~~~f~~~ss~g~ikIw~~s~~~ll~~~ 2406 (2439)
T KOG1064|consen 2374 -------FQA--LD-TREYFVTGSSEGNIKIWRLSEFGLLHTF 2406 (2439)
T ss_pred -------hhh--hh-hhheeeccCcccceEEEEccccchhhcC
Confidence 122 23 4578999999999999999988655554
No 268
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.13 E-value=0.2 Score=56.95 Aligned_cols=92 Identities=17% Similarity=0.201 Sum_probs=57.5
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCC-CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKS-PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~-pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
...+|.|..+|..+++.+........ ....... .|.+|.+++.+|. +.+||..++ +.++++.
T Consensus 285 ~~~~G~l~~~d~~tG~~~W~~~~~~~~~~ssp~i--~g~~l~~~~~~G~-l~~~d~~tG--------------~~~~~~~ 347 (377)
T TIGR03300 285 TDADGVVVALDRRSGSELWKNDELKYRQLTAPAV--VGGYLVVGDFEGY-LHWLSREDG--------------SFVARLK 347 (377)
T ss_pred ECCCCeEEEEECCCCcEEEccccccCCccccCEE--ECCEEEEEeCCCE-EEEEECCCC--------------CEEEEEE
Confidence 35679999999999988766632111 1222222 4668888999996 899998876 3445543
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
-+.. ....+.++. |+ .|.+++.||+++.|.
T Consensus 348 ~~~~-~~~~sp~~~-~~-~l~v~~~dG~l~~~~ 377 (377)
T TIGR03300 348 TDGS-GIASPPVVV-GD-GLLVQTRDGDLYAFR 377 (377)
T ss_pred cCCC-ccccCCEEE-CC-EEEEEeCCceEEEeC
Confidence 2211 111222222 33 477899999998874
No 269
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=97.13 E-value=0.005 Score=68.83 Aligned_cols=114 Identities=19% Similarity=0.299 Sum_probs=82.8
Q ss_pred eEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC-CC
Q 002446 413 ISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS-RG 491 (921)
Q Consensus 413 IsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~-Dg 491 (921)
+-+..|+|+|++|++++-.-..|.+|++..+.- .....+.++.|.- -.-|+|+|++++.-+.+. ++
T Consensus 147 ~H~a~~tP~~~~l~v~DLG~Dri~~y~~~dg~L----------~~~~~~~v~~G~G---PRHi~FHpn~k~aY~v~EL~s 213 (346)
T COG2706 147 VHSANFTPDGRYLVVPDLGTDRIFLYDLDDGKL----------TPADPAEVKPGAG---PRHIVFHPNGKYAYLVNELNS 213 (346)
T ss_pred cceeeeCCCCCEEEEeecCCceEEEEEcccCcc----------ccccccccCCCCC---cceEEEcCCCcEEEEEeccCC
Confidence 778899999999999986544699999997611 0111233344432 467999999999877664 99
Q ss_pred cEEEEecCCC-CCceeecCCCCCcccccCCcCCccccCCCCCCCCCCCCcccccCC
Q 002446 492 TSHLFAINPL-GGSVNFQPTDANFTTKHGAMAKSGVRWPPNLGLQMPNQQSLCASG 546 (921)
Q Consensus 492 TVhVWdi~~~-g~~~~l~~H~~~~~~~~~~~~~~~~r~~~~s~l~~~~~~~l~~~~ 546 (921)
||-+|.+++. +....++.|...+.+|.|..+...++.+ +|+.-|+++|
T Consensus 214 tV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis-------~dGrFLYasN 262 (346)
T COG2706 214 TVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHIS-------PDGRFLYASN 262 (346)
T ss_pred EEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEEC-------CCCCEEEEec
Confidence 9999999996 4556889998888888777666655555 4566666655
No 270
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=97.12 E-value=0.0044 Score=74.47 Aligned_cols=102 Identities=23% Similarity=0.342 Sum_probs=77.3
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC------C---CEEEEEeCCCCCCCCCCccCCC
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ------G---HNINIFKIIPGILGTSSACDAG 454 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D------G---t~IrIWdi~~g~~~~~s~~~~~ 454 (921)
+-+.+.|+|.|+|+.++.+-+.|..|++.|.+|.|--... |++.+.. | +.+.|-|+.+|.
T Consensus 441 AvGT~sGTV~vvdvst~~v~~~fsvht~~VkgleW~g~ss-lvSfsys~~n~~sg~vrN~l~vtdLrtGl---------- 509 (1062)
T KOG1912|consen 441 AVGTNSGTVDVVDVSTNAVAASFSVHTSLVKGLEWLGNSS-LVSFSYSHVNSASGGVRNDLVVTDLRTGL---------- 509 (1062)
T ss_pred EeecCCceEEEEEecchhhhhhhcccccceeeeeecccee-EEEeeeccccccccceeeeEEEEEccccc----------
Confidence 3456789999999999999999999999999999976655 4444332 1 124566777761
Q ss_pred CceeEEEEEe--cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 455 TSYVHLYRLQ--RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 455 ~~~~~l~~l~--RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
. ..+| ++...+.|..|--|.-++|||+.=.|.-+-|||+.+.
T Consensus 510 ---s--k~fR~l~~~despI~~irvS~~~~yLai~Fr~~plEiwd~kt~ 553 (1062)
T KOG1912|consen 510 ---S--KRFRGLQKPDESPIRAIRVSSSGRYLAILFRREPLEIWDLKTL 553 (1062)
T ss_pred ---c--cccccCCCCCcCcceeeeecccCceEEEEecccchHHHhhccc
Confidence 1 1232 4555567999999999999999999999999999654
No 271
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=97.10 E-value=0.0067 Score=66.95 Aligned_cols=97 Identities=10% Similarity=0.056 Sum_probs=68.9
Q ss_pred CCEEEEEECCC-C--ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 389 VGMVIVRDIVS-K--NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 389 ~G~V~IwDl~s-~--~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
|..-+||.... + ++.-.|..|....+++.++|.+..+|++|.- +.|-||-.+....+=- .+|+.+-.|
T Consensus 76 drnayVw~~~~~~~WkptlvLlRiNrAAt~V~WsP~enkFAVgSga-r~isVcy~E~ENdWWV--------sKhikkPir 146 (361)
T KOG1523|consen 76 DRNAYVWTQPSGGTWKPTLVLLRINRAATCVKWSPKENKFAVGSGA-RLISVCYYEQENDWWV--------SKHIKKPIR 146 (361)
T ss_pred CCCccccccCCCCeeccceeEEEeccceeeEeecCcCceEEeccCc-cEEEEEEEecccceeh--------hhhhCCccc
Confidence 33445555522 2 3455667889999999999999999999986 5689987765411100 022222212
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
..|.+++|.|++-.||+||.|+.++||..
T Consensus 147 ----Stv~sldWhpnnVLlaaGs~D~k~rVfSa 175 (361)
T KOG1523|consen 147 ----STVTSLDWHPNNVLLAAGSTDGKCRVFSA 175 (361)
T ss_pred ----cceeeeeccCCcceecccccCcceeEEEE
Confidence 34999999999999999999999999974
No 272
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=97.08 E-value=0.012 Score=65.44 Aligned_cols=99 Identities=20% Similarity=0.364 Sum_probs=77.1
Q ss_pred CCCCEEEEE--ECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 387 DNVGMVIVR--DIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 387 ~~~G~V~Iw--Dl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
...|.|.+- +...-.++.++++|..+|.+++++|...+|.+++.|- .+.+||+.-. . ...+++.
T Consensus 172 d~~gqvt~lr~~~~~~~~i~~~~~h~~~~~~l~Wd~~~~~LfSg~~d~-~vi~wdigg~-~------------g~~~el~ 237 (404)
T KOG1409|consen 172 DHSGQITMLKLEQNGCQLITTFNGHTGEVTCLKWDPGQRLLFSGASDH-SVIMWDIGGR-K------------GTAYELQ 237 (404)
T ss_pred ccccceEEEEEeecCCceEEEEcCcccceEEEEEcCCCcEEEeccccC-ceEEEeccCC-c------------ceeeeec
Confidence 444555553 3445678899999999999999999999999999995 5899999754 1 1235554
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
|+ ..+|+.++.-+--+.+.+.+.||.|-+|+++-.
T Consensus 238 -gh-~~kV~~l~~~~~t~~l~S~~edg~i~~w~mn~~ 272 (404)
T KOG1409|consen 238 -GH-NDKVQALSYAQHTRQLISCGEDGGIVVWNMNVK 272 (404)
T ss_pred -cc-hhhhhhhhhhhhheeeeeccCCCeEEEEeccce
Confidence 33 345888888888899999999999999999753
No 273
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=97.07 E-value=0.0029 Score=69.87 Aligned_cols=86 Identities=17% Similarity=0.279 Sum_probs=66.8
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
.+++|.+|++....--..+..-..+++++++||||+ +|.|..-|-+ |.||.+.+. ++.+ +.
T Consensus 69 k~~~vqvwsl~Qpew~ckIdeg~agls~~~WSPdgrhiL~tseF~lr-iTVWSL~t~------------~~~~---~~-- 130 (447)
T KOG4497|consen 69 KDPKVQVWSLVQPEWYCKIDEGQAGLSSISWSPDGRHILLTSEFDLR-ITVWSLNTQ------------KGYL---LP-- 130 (447)
T ss_pred ccceEEEEEeecceeEEEeccCCCcceeeeECCCcceEeeeecceeE-EEEEEeccc------------eeEE---ec--
Confidence 367999999998887788888889999999999996 4555556654 999999875 2222 22
Q ss_pred cccccEEEEEEccCCCEEEEEeCCC
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRG 491 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~Dg 491 (921)
+..+.+..++|.|||++.|..+.+.
T Consensus 131 ~pK~~~kg~~f~~dg~f~ai~sRrD 155 (447)
T KOG4497|consen 131 HPKTNVKGYAFHPDGQFCAILSRRD 155 (447)
T ss_pred ccccCceeEEECCCCceeeeeeccc
Confidence 2223478999999999999998763
No 274
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=97.03 E-value=0.0077 Score=68.61 Aligned_cols=102 Identities=10% Similarity=0.036 Sum_probs=76.0
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEec---------CCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASV---------QGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~---------DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
|.|.|.|..+++.+.++..-..|-. + +||||+.|..|.. +...|.|||+.+. ..+
T Consensus 27 ~~v~ViD~~~~~v~g~i~~G~~P~~-~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~--------------~~~ 90 (352)
T TIGR02658 27 TQVYTIDGEAGRVLGMTDGGFLPNP-V-VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTH--------------LPI 90 (352)
T ss_pred ceEEEEECCCCEEEEEEEccCCCce-e-ECCCCCEEEEEeccccccccCCCCCEEEEEECccC--------------cEE
Confidence 7899999999999999985444443 4 9999999999887 5557999999986 334
Q ss_pred EEEecccc-----cccEEEEEEccCCCEEEEEe-C-CCcEEEEecCCCCCceee
Q 002446 461 YRLQRGLT-----NAVIQDISFSDDSNWIMISS-S-RGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 461 ~~l~RG~t-----~a~I~sIaFSPDg~~LAsgS-~-DgTVhVWdi~~~g~~~~l 507 (921)
.++.-+.. ...-..+++||||++|.+.. . +..|-|.|+....-...+
T Consensus 91 ~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n~~p~~~V~VvD~~~~kvv~ei 144 (352)
T TIGR02658 91 ADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQFSPSPAVGVVDLEGKAFVRMM 144 (352)
T ss_pred eEEccCCCchhhccCccceEEECCCCCEEEEecCCCCCEEEEEECCCCcEEEEE
Confidence 44432211 12245799999999999877 3 789999999886444434
No 275
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=96.97 E-value=0.71 Score=59.25 Aligned_cols=98 Identities=14% Similarity=0.192 Sum_probs=66.1
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC--CCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ--GHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D--Gt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
.-.++||+-+ |.+..+-+.-.+--.+|+|-|+|.++|++-.. ...|..|.=. | ..+--+.++..
T Consensus 236 ~R~iRVy~Re-G~L~stSE~v~gLe~~l~WrPsG~lIA~~q~~~~~~~VvFfErN-G------------LrhgeF~l~~~ 301 (928)
T PF04762_consen 236 RRVIRVYSRE-GELQSTSEPVDGLEGALSWRPSGNLIASSQRLPDRHDVVFFERN-G------------LRHGEFTLRFD 301 (928)
T ss_pred eeEEEEECCC-ceEEeccccCCCccCCccCCCCCCEEEEEEEcCCCcEEEEEecC-C------------cEeeeEecCCC
Confidence 3689999976 55444444333334568999999999998762 2345555422 1 11223555433
Q ss_pred cccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.....|..|+|++||..||+.-.|. |.+|-...|
T Consensus 302 ~~~~~v~~l~Wn~ds~iLAv~~~~~-vqLWt~~NY 335 (928)
T PF04762_consen 302 PEEEKVIELAWNSDSEILAVWLEDR-VQLWTRSNY 335 (928)
T ss_pred CCCceeeEEEECCCCCEEEEEecCC-ceEEEeeCC
Confidence 3345699999999999999988665 999998776
No 276
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=96.92 E-value=0.48 Score=49.49 Aligned_cols=57 Identities=12% Similarity=0.063 Sum_probs=42.5
Q ss_pred cEEEEEECCCCcEEEEEeCC---CCEE--EEEEcCCEEEEEeCCEEEEEECCCCcEEEEEec
Q 002446 206 TVVHFYSLRSQSYVHMLKFR---SPIY--SVRCSSRVVAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~---s~V~--sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
++|..||+++|+.+....+. .... .+.-.+++++...++.|++||+.|++.+++...
T Consensus 3 g~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~ 64 (238)
T PF13360_consen 3 GTLSALDPRTGKELWSYDLGPGIGGPVATAVPDGGRVYVASGDGNLYALDAKTGKVLWRFDL 64 (238)
T ss_dssp SEEEEEETTTTEEEEEEECSSSCSSEEETEEEETTEEEEEETTSEEEEEETTTSEEEEEEEC
T ss_pred CEEEEEECCCCCEEEEEECCCCCCCccceEEEeCCEEEEEcCCCEEEEEECCCCCEEEEeec
Confidence 67999999999999999872 2333 222234444446889999999999998888764
No 277
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=96.88 E-value=0.012 Score=71.93 Aligned_cols=182 Identities=14% Similarity=0.128 Sum_probs=124.6
Q ss_pred cEEEEEECCCCcEEEEEeCCC-CEEEEEEcCCEEEE-EeCCEEEEEECCCCcEEEEEecCCCccCCCCCCCCCcccccee
Q 002446 206 TVVHFYSLRSQSYVHMLKFRS-PIYSVRCSSRVVAI-CQAAQVHCFDAATLEIEYAILTNPIVMGHPSAGGIGIGYGPLA 283 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s-~V~sV~~S~riLAV-a~d~~I~IwDl~T~~~l~tL~t~p~~~g~p~~~g~~i~~~piA 283 (921)
..+-.+|+++.+..+.....+ .|.=++-|.|++.. ...++|.+-|..+.+.++++.+|.. ....|.
T Consensus 157 ~~li~~Dl~~~~e~r~~~v~a~~v~imR~Nnr~lf~G~t~G~V~LrD~~s~~~iht~~aHs~------------siSDfD 224 (1118)
T KOG1275|consen 157 EKLIHIDLNTEKETRTTNVSASGVTIMRYNNRNLFCGDTRGTVFLRDPNSFETIHTFDAHSG------------SISDFD 224 (1118)
T ss_pred hheeeeecccceeeeeeeccCCceEEEEecCcEEEeecccceEEeecCCcCceeeeeecccc------------ceeeee
Confidence 456788999999988888854 68888888887776 5668999999999999999998843 122233
Q ss_pred ecCceEEecCCCceecCCCccCCcccccccccccccCCCcceeehhhhcchhhcceeEecCCccccccccccccccCCCc
Q 002446 284 VGPRWLAYSGSPVVVSNDGRVNPQHLMQSRSFSGFASNGSRVAHYAKESSKHLAAGIVNLGDLGYKKLSQYCSEFLPDSQ 363 (921)
Q Consensus 284 lgpRwLAyas~~~~~s~~GrvsPq~l~~s~~~~~~~s~g~~Va~~A~~~sK~LasGl~~lGd~g~k~ls~y~~~~~p~~~ 363 (921)
+....|+.. |-..+ .|
T Consensus 225 v~GNlLitC---------------------------------------------------G~S~R----~~--------- 240 (1118)
T KOG1275|consen 225 VQGNLLITC---------------------------------------------------GYSMR----RY--------- 240 (1118)
T ss_pred ccCCeEEEe---------------------------------------------------ecccc----cc---------
Confidence 322222221 10000 00
Q ss_pred CCcccccCCCCCCCcccCcccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCC
Q 002446 364 NSLQSAIPGGKSNGTVNGHFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 364 ~si~sa~~~~k~~g~v~g~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~ 442 (921)
.-.-|--|+|||+...+.+.-+.-|.+| .-+.|.|. -+.||.+|.-|. +.+-|..+
T Consensus 241 ---------------------~l~~D~FvkVYDLRmmral~PI~~~~~P-~flrf~Psl~t~~~V~S~sGq-~q~vd~~~ 297 (1118)
T KOG1275|consen 241 ---------------------NLAMDPFVKVYDLRMMRALSPIQFPYGP-QFLRFHPSLTTRLAVTSQSGQ-FQFVDTAT 297 (1118)
T ss_pred ---------------------cccccchhhhhhhhhhhccCCcccccCc-hhhhhcccccceEEEEecccc-eeeccccc
Confidence 0012446899999999888888877777 67899997 567888888887 77777443
Q ss_pred CCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 443 GILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 443 g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
- +.+.....++... ..-|..+++|+.++.+|.|-.+|.||+|.=
T Consensus 298 l-------sNP~~~~~~v~p~-----~s~i~~fDiSsn~~alafgd~~g~v~~wa~ 341 (1118)
T KOG1275|consen 298 L-------SNPPAGVKMVNPN-----GSGISAFDISSNGDALAFGDHEGHVNLWAD 341 (1118)
T ss_pred c-------CCCccceeEEccC-----CCcceeEEecCCCceEEEecccCcEeeecC
Confidence 2 0011111222111 122889999999999999999999999983
No 278
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=96.87 E-value=0.021 Score=66.93 Aligned_cols=51 Identities=25% Similarity=0.488 Sum_probs=41.5
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC-----CEEEEEeCC
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG-----HNINIFKII 441 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG-----t~IrIWdi~ 441 (921)
.|.|-|||+.+.+++..+++-.. +-..|+|||.+++||..-= ..|+||+..
T Consensus 335 ~G~mEvwDv~n~K~i~~~~a~~t--t~~eW~PdGe~flTATTaPRlrvdNg~Kiwhyt 390 (566)
T KOG2315|consen 335 PGDMEVWDVPNRKLIAKFKAANT--TVFEWSPDGEYFLTATTAPRLRVDNGIKIWHYT 390 (566)
T ss_pred CCceEEEeccchhhccccccCCc--eEEEEcCCCcEEEEEeccccEEecCCeEEEEec
Confidence 58899999999999999987654 4478999999999997531 238999875
No 279
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=96.79 E-value=0.69 Score=51.88 Aligned_cols=96 Identities=21% Similarity=0.276 Sum_probs=63.5
Q ss_pred EEEEEECCCCceEEE--e--ccCCCCeEEEEECCCCCEEEEEecCCC------EEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 391 MVIVRDIVSKNVIAQ--F--RAHKSPISALCFDPSGILLVTASVQGH------NINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~--~--~aH~~pIsaLaFSPdGtlLATaS~DGt------~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
.+.+-|..+++++.+ + .-|.-+|..|+++++|+.+.-.-.+|- .+-+++-... ..+
T Consensus 139 sL~~ld~~sG~ll~q~~Lp~~~~~lSiRHLa~~~~G~V~~a~Q~qg~~~~~~PLva~~~~g~~--------------~~~ 204 (305)
T PF07433_consen 139 SLVYLDARSGALLEQVELPPDLHQLSIRHLAVDGDGTVAFAMQYQGDPGDAPPLVALHRRGGA--------------LRL 204 (305)
T ss_pred ceEEEecCCCceeeeeecCccccccceeeEEecCCCcEEEEEecCCCCCccCCeEEEEcCCCc--------------cee
Confidence 355678888988877 5 238889999999999998887766653 1111111110 000
Q ss_pred EEE----ecccccccEEEEEEccCCCEEEEEeCCC-cEEEEecCCC
Q 002446 461 YRL----QRGLTNAVIQDISFSDDSNWIMISSSRG-TSHLFAINPL 501 (921)
Q Consensus 461 ~~l----~RG~t~a~I~sIaFSPDg~~LAsgS~Dg-TVhVWdi~~~ 501 (921)
... .+.+... |-+|+|++|+.++|++|-+| .+.+||..+.
T Consensus 205 ~~~p~~~~~~l~~Y-~gSIa~~~~g~~ia~tsPrGg~~~~~d~~tg 249 (305)
T PF07433_consen 205 LPAPEEQWRRLNGY-IGSIAADRDGRLIAVTSPRGGRVAVWDAATG 249 (305)
T ss_pred ccCChHHHHhhCCc-eEEEEEeCCCCEEEEECCCCCEEEEEECCCC
Confidence 111 1122222 88999999999998888765 7899998875
No 280
>PRK04043 tolB translocation protein TolB; Provisional
Probab=96.56 E-value=0.29 Score=57.22 Aligned_cols=81 Identities=23% Similarity=0.187 Sum_probs=49.0
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC-CC-EEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ-GH-NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D-Gt-~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|.++|+.+++. ..+..+........|+|||+.|+-.+.. |. .|.+.|+..+ ..+.+ .. .|.
T Consensus 257 ~~Iy~~dl~~g~~-~~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g------------~~~rl-t~-~g~ 321 (419)
T PRK04043 257 PDIYLYDTNTKTL-TQITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSG------------SVEQV-VF-HGK 321 (419)
T ss_pred cEEEEEECCCCcE-EEcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCC------------CeEeC-cc-CCC
Confidence 4688888877763 3444443333446899999988777654 33 3455555543 12221 11 122
Q ss_pred ccccEEEEEEccCCCEEEEEeCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
...+|||||++||..+..
T Consensus 322 -----~~~~~SPDG~~Ia~~~~~ 339 (419)
T PRK04043 322 -----NNSSVSTYKNYIVYSSRE 339 (419)
T ss_pred -----cCceECCCCCEEEEEEcC
Confidence 124899999999988765
No 281
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=96.54 E-value=0.012 Score=64.46 Aligned_cols=102 Identities=13% Similarity=0.138 Sum_probs=73.0
Q ss_pred CCCEEEEEECCCCce--EEEeccCCCCeEEEEECCC-CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 388 NVGMVIVRDIVSKNV--IAQFRAHKSPISALCFDPS-GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~--l~~~~aH~~pIsaLaFSPd-GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
..|.+.+-+.....+ ++.+++|.-++...+|+.. -.++.||++||. +.-||+.-. ...++.-.
T Consensus 141 s~G~~~~v~~t~~~le~vq~wk~He~E~Wta~f~~~~pnlvytGgDD~~-l~~~D~R~p-------------~~~i~~n~ 206 (339)
T KOG0280|consen 141 SRGSISGVYETEMVLEKVQTWKVHEFEAWTAKFSDKEPNLVYTGGDDGS-LSCWDIRIP-------------KTFIWHNS 206 (339)
T ss_pred CCCcEEEEecceeeeeecccccccceeeeeeecccCCCceEEecCCCce-EEEEEecCC-------------cceeeecc
Confidence 345555444444433 3488999999999999874 568999999996 899999832 12334322
Q ss_pred cccccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 465 RGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 465 RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
+-|+.. |.+|.=|| +..+||+|+-|-+|++||...-+++
T Consensus 207 kvH~~G-V~SI~ss~~~~~~I~TGsYDe~i~~~DtRnm~kP 246 (339)
T KOG0280|consen 207 KVHTSG-VVSIYSSPPKPTYIATGSYDECIRVLDTRNMGKP 246 (339)
T ss_pred eeeecc-eEEEecCCCCCceEEEeccccceeeeehhcccCc
Confidence 333333 78887775 7999999999999999999865443
No 282
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=96.33 E-value=0.041 Score=67.65 Aligned_cols=100 Identities=14% Similarity=0.216 Sum_probs=69.4
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEEEEEeCCCCcCCccccCCcccc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLLVFCADGSRSCGTKVQDGLATA 187 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLLAvv~~g~~~g~~~~~Dg~~~~ 187 (921)
.++..|..+.+-.+|+.... ...+..-..+.|..++.- .-+.+|++.
T Consensus 149 ~~i~Gg~Q~~li~~Dl~~~~-e~r~~~v~a~~v~imR~N-----------------nr~lf~G~t--------------- 195 (1118)
T KOG1275|consen 149 TLIMGGLQEKLIHIDLNTEK-ETRTTNVSASGVTIMRYN-----------------NRNLFCGDT--------------- 195 (1118)
T ss_pred ceeecchhhheeeeecccce-eeeeeeccCCceEEEEec-----------------CcEEEeecc---------------
Confidence 55555667788899998732 222333334457766642 123445542
Q ss_pred cCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeC-CCCEEEEEEcCCEEEEE----------eCCEEEEEECCCCcE
Q 002446 188 CNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKF-RSPIYSVRCSSRVVAIC----------QAAQVHCFDAATLEI 256 (921)
Q Consensus 188 ~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f-~s~V~sV~~S~riLAVa----------~d~~I~IwDl~T~~~ 256 (921)
.++|.+=|+++.+.+|++.. ...|.++...+++|+.| .|.-|.+||+++++.
T Consensus 196 -----------------~G~V~LrD~~s~~~iht~~aHs~siSDfDv~GNlLitCG~S~R~~~l~~D~FvkVYDLRmmra 258 (1118)
T KOG1275|consen 196 -----------------RGTVFLRDPNSFETIHTFDAHSGSISDFDVQGNLLITCGYSMRRYNLAMDPFVKVYDLRMMRA 258 (1118)
T ss_pred -----------------cceEEeecCCcCceeeeeeccccceeeeeccCCeEEEeecccccccccccchhhhhhhhhhhc
Confidence 17899999999999999985 67899999998888775 245688999998875
Q ss_pred E
Q 002446 257 E 257 (921)
Q Consensus 257 l 257 (921)
+
T Consensus 259 l 259 (1118)
T KOG1275|consen 259 L 259 (1118)
T ss_pred c
Confidence 4
No 283
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=96.18 E-value=1.9 Score=45.95 Aligned_cols=99 Identities=17% Similarity=0.134 Sum_probs=62.5
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
|.|..++.. ++....+ ..-..-..|+|+|||+.|..+......|..|++... ... ....+.+..+..+.
T Consensus 115 g~v~~~~~~-~~~~~~~-~~~~~pNGi~~s~dg~~lyv~ds~~~~i~~~~~~~~-~~~------~~~~~~~~~~~~~~-- 183 (246)
T PF08450_consen 115 GSVYRIDPD-GKVTVVA-DGLGFPNGIAFSPDGKTLYVADSFNGRIWRFDLDAD-GGE------LSNRRVFIDFPGGP-- 183 (246)
T ss_dssp EEEEEEETT-SEEEEEE-EEESSEEEEEEETTSSEEEEEETTTTEEEEEEEETT-TCC------EEEEEEEEE-SSSS--
T ss_pred cceEEECCC-CeEEEEe-cCcccccceEECCcchheeecccccceeEEEecccc-ccc------eeeeeeEEEcCCCC--
Confidence 677778877 4433332 233456789999999988766666555778877643 000 00112233333221
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
...-.+++..+|+..++.-..+.|.+|+-.
T Consensus 184 g~pDG~~vD~~G~l~va~~~~~~I~~~~p~ 213 (246)
T PF08450_consen 184 GYPDGLAVDSDGNLWVADWGGGRIVVFDPD 213 (246)
T ss_dssp CEEEEEEEBTTS-EEEEEETTTEEEEEETT
T ss_pred cCCCcceEcCCCCEEEEEcCCCEEEEECCC
Confidence 236789999999998888888899998865
No 284
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=96.10 E-value=0.013 Score=66.37 Aligned_cols=96 Identities=20% Similarity=0.184 Sum_probs=75.5
Q ss_pred EEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 392 VIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 392 V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
|++.+-.+.+.+..+..|...|..|+|||... +|..+|.+. .|+|+|+.+. .+...|..+ +
T Consensus 175 v~~l~~~~fkssq~lp~~g~~IrdlafSp~~~GLl~~asl~n-kiki~dlet~------------~~vssy~a~-----~ 236 (463)
T KOG1645|consen 175 VQKLESHDFKSSQILPGEGSFIRDLAFSPFNEGLLGLASLGN-KIKIMDLETS------------CVVSSYIAY-----N 236 (463)
T ss_pred eEEeccCCcchhhcccccchhhhhhccCccccceeeeeccCc-eEEEEecccc------------eeeeheecc-----C
Confidence 78888777777778889999999999999988 788888875 4999999985 233344443 3
Q ss_pred cEEEEEEccCCC-EEEEEeCCCcEEEEecCCCCCce
Q 002446 471 VIQDISFSDDSN-WIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 471 ~I~sIaFSPDg~-~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
.|++++|.-|.. +|..|-.+|.|.|||+....+..
T Consensus 237 ~~wSC~wDlde~h~IYaGl~nG~VlvyD~R~~~~~~ 272 (463)
T KOG1645|consen 237 QIWSCCWDLDERHVIYAGLQNGMVLVYDMRQPEGPL 272 (463)
T ss_pred CceeeeeccCCcceeEEeccCceEEEEEccCCCchH
Confidence 499999987665 56677889999999998765543
No 285
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=96.06 E-value=0.76 Score=50.60 Aligned_cols=99 Identities=18% Similarity=0.243 Sum_probs=60.8
Q ss_pred CCCCeEEEEECCCCCEEEEEecCCC----------EEEEEeCCCCCCC----CCCccCC-----CCceeEEEE----Eec
Q 002446 409 HKSPISALCFDPSGILLVTASVQGH----------NINIFKIIPGILG----TSSACDA-----GTSYVHLYR----LQR 465 (921)
Q Consensus 409 H~~pIsaLaFSPdGtlLATaS~DGt----------~IrIWdi~~g~~~----~~s~~~~-----~~~~~~l~~----l~R 465 (921)
+...|+++.|+|.-++|..|+..-. -+.-|.+..+.+- .....+. ......+.. .+.
T Consensus 146 yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~~~~~~~~~~~~~~~~~~~fs~~ 225 (282)
T PF15492_consen 146 YPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDDITASSKRRGLLRIPSFKFFSRQ 225 (282)
T ss_pred CCCceeEEEEcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCccccccccccceeeccceeeeecc
Confidence 4679999999999898887753211 1567777655220 0000000 001111111 112
Q ss_pred ccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
+.....|..|+.||||+.||+...+|.+-||++..-.....+
T Consensus 226 ~~~~d~i~kmSlSPdg~~La~ih~sG~lsLW~iPsL~~~~~W 267 (282)
T PF15492_consen 226 GQEQDGIFKMSLSPDGSLLACIHFSGSLSLWEIPSLRLQRSW 267 (282)
T ss_pred ccCCCceEEEEECCCCCEEEEEEcCCeEEEEecCcchhhccc
Confidence 323344999999999999999999999999999665444333
No 286
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=95.97 E-value=0.79 Score=53.83 Aligned_cols=123 Identities=14% Similarity=0.121 Sum_probs=78.6
Q ss_pred CCCcEEEEEEecccCCCCCCCeEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccccCCCEE
Q 002446 87 SHDQVLWAGFDKLESEAGATRRVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFAEVRPLL 166 (921)
Q Consensus 87 ~kd~V~w~~Fd~~~~d~~~~~~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~~~rPLL 166 (921)
....+..++|.. -| ..|......|+++|+-+..+ .++.-+..-|+.+.+.|+ +.+|
T Consensus 31 ~~~p~~~~~~SP---~G----~~l~~~~~~~V~~~~g~~~~---~l~~~~~~~V~~~~fSP~--------------~kYL 86 (561)
T COG5354 31 ENWPVAYVSESP---LG----TYLFSEHAAGVECWGGPSKA---KLVRFRHPDVKYLDFSPN--------------EKYL 86 (561)
T ss_pred cCcchhheeecC---cc----hheehhhccceEEccccchh---heeeeecCCceecccCcc--------------ccee
Confidence 445677777766 33 78888889999999988743 344455667888888774 3455
Q ss_pred EEEeCCCCcCCccccCCcccccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCCC-C-----EEEEEEcCCEEEE
Q 002446 167 VFCADGSRSCGTKVQDGLATACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFRS-P-----IYSVRCSSRVVAI 240 (921)
Q Consensus 167 Avv~~g~~~g~~~~~Dg~~~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~s-~-----V~sV~~S~riLAV 240 (921)
..-..... .+. .| .+.+....+.+.+||..+|..+..+.... + +..-.++.+++|=
T Consensus 87 ~tw~~~pi------~~p-----------e~-e~sp~~~~n~~~vwd~~sg~iv~sf~~~~q~~~~Wp~~k~s~~D~y~AR 148 (561)
T COG5354 87 VTWSREPI------IEP-----------EI-EISPFTSKNNVFVWDIASGMIVFSFNGISQPYLGWPVLKFSIDDKYVAR 148 (561)
T ss_pred eeeccCCc------cCh-----------hh-ccCCccccCceeEEeccCceeEeeccccCCcccccceeeeeecchhhhh
Confidence 43333211 010 00 01122233579999999999999887632 2 4444445666665
Q ss_pred EeCCEEEEEEC
Q 002446 241 CQAAQVHCFDA 251 (921)
Q Consensus 241 a~d~~I~IwDl 251 (921)
.....++|+++
T Consensus 149 vv~~sl~i~e~ 159 (561)
T COG5354 149 VVGSSLYIHEI 159 (561)
T ss_pred hccCeEEEEec
Confidence 56778999997
No 287
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.87 E-value=0.62 Score=50.98 Aligned_cols=61 Identities=13% Similarity=0.136 Sum_probs=42.8
Q ss_pred cccccCCCCEEEEEECCCCceEEE-----eccCCCCeEEEEECCCCC--EEEEEecCCCEEEEEeCCCC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQ-----FRAHKSPISALCFDPSGI--LLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~-----~~aH~~pIsaLaFSPdGt--lLATaS~DGt~IrIWdi~~g 443 (921)
.|+.+..+|++.|||+........ -..|.++|..+.|+|-|- +|.-.-.-+ -++|-|+.++
T Consensus 217 ~FAv~~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g~lDLLf~sEhfs-~~hv~D~R~~ 284 (344)
T KOG4532|consen 217 QFAVVFQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYGLLDLLFISEHFS-RVHVVDTRNY 284 (344)
T ss_pred eEEEEecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCCcceEEEEecCcc-eEEEEEcccC
Confidence 456677899999999987543222 236889999999999765 343333333 4788888875
No 288
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=95.57 E-value=0.052 Score=63.70 Aligned_cols=93 Identities=17% Similarity=0.246 Sum_probs=63.2
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEec----------CCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASV----------QGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~----------DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
-|.+|--.+-..++.| .|. .|..+.|||.-+||+|=|. +|+.+.|||+.+| ...
T Consensus 232 GI~lWGG~~f~r~~RF-~Hp-~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWDI~tG--------------~lk 295 (698)
T KOG2314|consen 232 GIALWGGESFDRIQRF-YHP-GVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWDIATG--------------LLK 295 (698)
T ss_pred ceeeecCccHHHHHhc-cCC-CceeeecCCccceEEEecCCccccCcccCCCceEEEEEcccc--------------chh
Confidence 3778865554444444 343 5889999999999999763 5677999999997 111
Q ss_pred EEEe--cccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 461 YRLQ--RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 461 ~~l~--RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
..+. ++. ...-.=.-||.|++|+|.-.. .+|+||+....
T Consensus 296 rsF~~~~~~-~~~WP~frWS~DdKy~Arm~~-~sisIyEtpsf 336 (698)
T KOG2314|consen 296 RSFPVIKSP-YLKWPIFRWSHDDKYFARMTG-NSISIYETPSF 336 (698)
T ss_pred cceeccCCC-ccccceEEeccCCceeEEecc-ceEEEEecCce
Confidence 1111 111 112334679999999998877 57999987664
No 289
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=95.52 E-value=1.4 Score=49.75 Aligned_cols=100 Identities=18% Similarity=0.235 Sum_probs=58.9
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
|.|+.+|. .+..+..+..|-.--+.|+|||||+.|..+......|.-|++... .+.. ++ ...........|.
T Consensus 143 G~lyr~~p-~g~~~~l~~~~~~~~NGla~SpDg~tly~aDT~~~~i~r~~~d~~-~g~~--~~--~~~~~~~~~~~G~-- 214 (307)
T COG3386 143 GSLYRVDP-DGGVVRLLDDDLTIPNGLAFSPDGKTLYVADTPANRIHRYDLDPA-TGPI--GG--RRGFVDFDEEPGL-- 214 (307)
T ss_pred ceEEEEcC-CCCEEEeecCcEEecCceEECCCCCEEEEEeCCCCeEEEEecCcc-cCcc--CC--cceEEEccCCCCC--
Confidence 55666665 466666666665555679999999999999888666777776631 1110 00 0001111112232
Q ss_pred ccEEEEEEccCCCEEEEEeCCC-cEEEEecC
Q 002446 470 AVIQDISFSDDSNWIMISSSRG-TSHLFAIN 499 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~Dg-TVhVWdi~ 499 (921)
.-.++...||.+-+++-.+| .|++|+..
T Consensus 215 --PDG~~vDadG~lw~~a~~~g~~v~~~~pd 243 (307)
T COG3386 215 --PDGMAVDADGNLWVAAVWGGGRVVRFNPD 243 (307)
T ss_pred --CCceEEeCCCCEEEecccCCceEEEECCC
Confidence 34567777787775444443 78888765
No 290
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=95.34 E-value=0.8 Score=48.82 Aligned_cols=95 Identities=23% Similarity=0.292 Sum_probs=59.1
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEEC-CCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFD-PSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFS-PdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.+.|..||..+++... +.... ...++|. ++|+++++. .++ +.++|..++ ....+.....+.
T Consensus 21 ~~~i~~~~~~~~~~~~-~~~~~--~~G~~~~~~~g~l~v~~-~~~--~~~~d~~~g------------~~~~~~~~~~~~ 82 (246)
T PF08450_consen 21 GGRIYRVDPDTGEVEV-IDLPG--PNGMAFDRPDGRLYVAD-SGG--IAVVDPDTG------------KVTVLADLPDGG 82 (246)
T ss_dssp TTEEEEEETTTTEEEE-EESSS--EEEEEEECTTSEEEEEE-TTC--EEEEETTTT------------EEEEEEEEETTC
T ss_pred CCEEEEEECCCCeEEE-EecCC--CceEEEEccCCEEEEEE-cCc--eEEEecCCC------------cEEEEeeccCCC
Confidence 4788999998876532 33222 5566777 787776664 443 577788775 344455553232
Q ss_pred -ccccEEEEEEccCCCEEEEEeCCCc------EEEEecCCC
Q 002446 468 -TNAVIQDISFSDDSNWIMISSSRGT------SHLFAINPL 501 (921)
Q Consensus 468 -t~a~I~sIaFSPDg~~LAsgS~DgT------VhVWdi~~~ 501 (921)
.....+++++.|||++.++.+.... =.||.+.+.
T Consensus 83 ~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~ 123 (246)
T PF08450_consen 83 VPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD 123 (246)
T ss_dssp SCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT
T ss_pred cccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC
Confidence 3455999999999998887765533 345666555
No 291
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=95.33 E-value=8 Score=49.95 Aligned_cols=75 Identities=7% Similarity=0.147 Sum_probs=51.1
Q ss_pred cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE-EEecccccccEEEEEEcc-CCCEEE
Q 002446 408 AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY-RLQRGLTNAVIQDISFSD-DSNWIM 485 (921)
Q Consensus 408 aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~-~l~RG~t~a~I~sIaFSP-Dg~~LA 485 (921)
.....|..|+||+|++.||..-.|. |.+|-.... .+.++ +++-. ....+..+.|+| +...|.
T Consensus 302 ~~~~~v~~l~Wn~ds~iLAv~~~~~--vqLWt~~NY-------------HWYLKqei~~~-~~~~~~~~~Wdpe~p~~L~ 365 (928)
T PF04762_consen 302 PEEEKVIELAWNSDSEILAVWLEDR--VQLWTRSNY-------------HWYLKQEIRFS-SSESVNFVKWDPEKPLRLH 365 (928)
T ss_pred CCCceeeEEEECCCCCEEEEEecCC--ceEEEeeCC-------------EEEEEEEEEcc-CCCCCCceEECCCCCCEEE
Confidence 3455789999999999999987663 899987764 22222 23211 122255599999 556688
Q ss_pred EEeCCCcEEEEec
Q 002446 486 ISSSRGTSHLFAI 498 (921)
Q Consensus 486 sgS~DgTVhVWdi 498 (921)
+.+..|.+..++.
T Consensus 366 v~t~~g~~~~~~~ 378 (928)
T PF04762_consen 366 VLTSNGQYEIYDF 378 (928)
T ss_pred EEecCCcEEEEEE
Confidence 8888788766655
No 292
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=95.29 E-value=0.091 Score=68.68 Aligned_cols=121 Identities=16% Similarity=0.196 Sum_probs=88.5
Q ss_pred ccccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC-----C----------
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL-----G---------- 446 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~-----~---------- 446 (921)
++++..+|.|++|.-..++.+..++ +-.+.|+.+.|+.+|.....+..||. +-+|.+.+-.. +
T Consensus 2223 Yltgs~dgsv~~~~w~~~~~v~~~rt~g~s~vtr~~f~~qGnk~~i~d~dg~-l~l~q~~pk~~~s~qchnk~~~Df~Fi 2301 (2439)
T KOG1064|consen 2223 YLTGSQDGSVRMFEWGHGQQVVCFRTAGNSRVTRSRFNHQGNKFGIVDGDGD-LSLWQASPKPYTSWQCHNKALSDFRFI 2301 (2439)
T ss_pred EEecCCCceEEEEeccCCCeEEEeeccCcchhhhhhhcccCCceeeeccCCc-eeecccCCcceeccccCCccccceeee
Confidence 4577889999999999999888888 33488999999999999999999997 89999876311 0
Q ss_pred --------CCCc----cCC----CCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeec
Q 002446 447 --------TSSA----CDA----GTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 447 --------~~s~----~~~----~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~ 508 (921)
.++- +.| ......+.+.+- .-++++++-|.-+.|.+|+.+|.|.|||+........++
T Consensus 2302 ~s~~~tag~s~d~~n~~lwDtl~~~~~s~v~~~H~----~gaT~l~~~P~~qllisggr~G~v~l~D~rqrql~h~~~ 2375 (2439)
T KOG1064|consen 2302 GSLLATAGRSSDNRNVCLWDTLLPPMNSLVHTCHD----GGATVLAYAPKHQLLISGGRKGEVCLFDIRQRQLRHTFQ 2375 (2439)
T ss_pred ehhhhccccCCCCCcccchhcccCcccceeeeecC----CCceEEEEcCcceEEEecCCcCcEEEeehHHHHHHHHhh
Confidence 0000 000 011122222221 227899999999999999999999999998765554443
No 293
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=95.22 E-value=0.97 Score=50.45 Aligned_cols=94 Identities=13% Similarity=0.211 Sum_probs=59.4
Q ss_pred CEEEEEECCCCc-eEE--EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 390 GMVIVRDIVSKN-VIA--QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 390 G~V~IwDl~s~~-~l~--~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
..|.+|++...+ .+. .+..+ ..|++|.. -+.+++.++.... +.++..... ...+..+.|-
T Consensus 107 ~~l~v~~l~~~~~l~~~~~~~~~-~~i~sl~~--~~~~I~vgD~~~s-v~~~~~~~~-------------~~~l~~va~d 169 (321)
T PF03178_consen 107 NKLYVYDLDNSKTLLKKAFYDSP-FYITSLSV--FKNYILVGDAMKS-VSLLRYDEE-------------NNKLILVARD 169 (321)
T ss_dssp TEEEEEEEETTSSEEEEEEE-BS-SSEEEEEE--ETTEEEEEESSSS-EEEEEEETT-------------TE-EEEEEEE
T ss_pred CEEEEEEccCcccchhhheecce-EEEEEEec--cccEEEEEEcccC-EEEEEEEcc-------------CCEEEEEEec
Confidence 578888887776 322 22222 24444443 4668888887654 677754432 1234445554
Q ss_pred cccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.....+.+++|-+|++.++++..+|.+++|...+
T Consensus 170 ~~~~~v~~~~~l~d~~~~i~~D~~gnl~~l~~~~ 203 (321)
T PF03178_consen 170 YQPRWVTAAEFLVDEDTIIVGDKDGNLFVLRYNP 203 (321)
T ss_dssp SS-BEEEEEEEE-SSSEEEEEETTSEEEEEEE-S
T ss_pred CCCccEEEEEEecCCcEEEEEcCCCeEEEEEECC
Confidence 4444589999987778999999999999999865
No 294
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.20 E-value=0.053 Score=63.28 Aligned_cols=124 Identities=21% Similarity=0.262 Sum_probs=82.6
Q ss_pred cccccCCCCEEEEEECCC-------CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC---------
Q 002446 382 HFPDADNVGMVIVRDIVS-------KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL--------- 445 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s-------~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~--------- 445 (921)
.|+++..|.+|++|.+.. ..+..+..+|+.+|..+.|=.|-+++|++ ||. |++||-.-+..
T Consensus 749 SFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~~lr~i~Sc--D~g-iHlWDPFigr~Laq~~dapk 825 (1034)
T KOG4190|consen 749 SFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLADLRSIASC--DGG-IHLWDPFIGRLLAQMEDAPK 825 (1034)
T ss_pred ceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeeeccceeeec--cCc-ceeecccccchhHhhhcCcc
Confidence 456778899999999864 34667788999999999999999999876 454 89999654311
Q ss_pred -CCC--------------Cc-cCCCCce--------eEEEEEec---ccccccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 446 -GTS--------------SA-CDAGTSY--------VHLYRLQR---GLTNAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 446 -~~~--------------s~-~~~~~~~--------~~l~~l~R---G~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
+.. .+ +...+.+ .-..+++- -..++.+.+|+..|.|+|+|.+-+.|+|-+.|.
T Consensus 826 ~~a~~~ikcl~nv~~~iliAgcsaeSTVKl~DaRsce~~~E~kVcna~~Pna~~R~iaVa~~GN~lAa~LSnGci~~LDa 905 (1034)
T KOG4190|consen 826 EGAGGNIKCLENVDRHILIAGCSAESTVKLFDARSCEWTCELKVCNAPGPNALTRAIAVADKGNKLAAALSNGCIAILDA 905 (1034)
T ss_pred cCCCceeEecccCcchheeeeccchhhheeeecccccceeeEEeccCCCCchheeEEEeccCcchhhHHhcCCcEEEEec
Confidence 000 00 0000000 00111110 112345889999999999999999999999998
Q ss_pred CCCCCceeec
Q 002446 499 NPLGGSVNFQ 508 (921)
Q Consensus 499 ~~~g~~~~l~ 508 (921)
.++.-...++
T Consensus 906 R~G~vINswr 915 (1034)
T KOG4190|consen 906 RNGKVINSWR 915 (1034)
T ss_pred CCCceeccCC
Confidence 7764444443
No 295
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.15 E-value=0.23 Score=54.16 Aligned_cols=99 Identities=12% Similarity=0.052 Sum_probs=65.0
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..+++.+-+....+...++.. -.+.++++|||++++++.++-.. |-.|.+... ...++. .+...
T Consensus 138 ht~k~~~~~~~s~~~~~h~~~--~~~ns~~~snd~~~~~~Vgds~~-Vf~y~id~~------------sey~~~-~~~a~ 201 (344)
T KOG4532|consen 138 HTGKTMVVSGDSNKFAVHNQN--LTQNSLHYSNDPSWGSSVGDSRR-VFRYAIDDE------------SEYIEN-IYEAP 201 (344)
T ss_pred cceeEEEEecCcccceeeccc--cceeeeEEcCCCceEEEecCCCc-ceEEEeCCc------------cceeee-eEecc
Confidence 334444444444443333332 12788999999999999887654 677777754 112222 11122
Q ss_pred ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
+.-.=.+.+||.....+|+++.||++-|||+..-+
T Consensus 202 t~D~gF~~S~s~~~~~FAv~~Qdg~~~I~DVR~~~ 236 (344)
T KOG4532|consen 202 TSDHGFYNSFSENDLQFAVVFQDGTCAIYDVRNMA 236 (344)
T ss_pred cCCCceeeeeccCcceEEEEecCCcEEEEEecccc
Confidence 22224688999999999999999999999997653
No 296
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=95.10 E-value=0.037 Score=38.49 Aligned_cols=28 Identities=25% Similarity=0.525 Sum_probs=26.0
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
..|.+++|+++++++++++.|+++++|+
T Consensus 13 ~~i~~~~~~~~~~~~~~~~~d~~~~~~~ 40 (40)
T smart00320 13 GPVTSVAFSPDGKYLASASDDGTIKLWD 40 (40)
T ss_pred CceeEEEECCCCCEEEEecCCCeEEEcC
Confidence 3599999999999999999999999996
No 297
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.04 E-value=0.02 Score=66.64 Aligned_cols=85 Identities=21% Similarity=0.256 Sum_probs=61.9
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCC
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDS 481 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg 481 (921)
.+..|.+|+..|.+++-=.+..-+++||.|.| +++|.+.+...+ .+...+.++.. . +...|.+|-|-.|-
T Consensus 727 rL~nf~GH~~~iRai~AidNENSFiSASkDKT-VKLWSik~EgD~-------~~tsaCQfTY~-a-Hkk~i~~igfL~~l 796 (1034)
T KOG4190|consen 727 RLCNFTGHQEKIRAIAAIDNENSFISASKDKT-VKLWSIKPEGDE-------IGTSACQFTYQ-A-HKKPIHDIGFLADL 796 (1034)
T ss_pred eeecccCcHHHhHHHHhcccccceeeccCCce-EEEEEeccccCc-------cccceeeeEhh-h-ccCcccceeeeecc
Confidence 35677899999999876667777999999987 899999975211 11112333432 1 23359999999999
Q ss_pred CEEEEEeCCCcEEEEec
Q 002446 482 NWIMISSSRGTSHLFAI 498 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWdi 498 (921)
+++|++ ||-||+||-
T Consensus 797 r~i~Sc--D~giHlWDP 811 (1034)
T KOG4190|consen 797 RSIASC--DGGIHLWDP 811 (1034)
T ss_pred ceeeec--cCcceeecc
Confidence 998876 899999984
No 298
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=94.95 E-value=7.9 Score=43.22 Aligned_cols=50 Identities=6% Similarity=0.246 Sum_probs=41.1
Q ss_pred cEEEEEECCCC-------cEEEEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCc
Q 002446 206 TVVHFYSLRSQ-------SYVHMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLE 255 (921)
Q Consensus 206 ~tVrIWDL~Tg-------~~V~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~ 255 (921)
+.|.++++... +.++..+++++|++|..-...|+++..++|++|++...+
T Consensus 62 Gri~v~~i~~~~~~~~~l~~i~~~~~~g~V~ai~~~~~~lv~~~g~~l~v~~l~~~~ 118 (321)
T PF03178_consen 62 GRILVFEISESPENNFKLKLIHSTEVKGPVTAICSFNGRLVVAVGNKLYVYDLDNSK 118 (321)
T ss_dssp EEEEEEEECSS-----EEEEEEEEEESS-EEEEEEETTEEEEEETTEEEEEEEETTS
T ss_pred cEEEEEEEEcccccceEEEEEEEEeecCcceEhhhhCCEEEEeecCEEEEEEccCcc
Confidence 88999999985 455666789999999986666888889999999998777
No 299
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=94.92 E-value=1.5 Score=53.89 Aligned_cols=117 Identities=13% Similarity=0.112 Sum_probs=85.8
Q ss_pred eEEEEEccCcEEEEEccCCCCeEEeeeeecCCEEEEEEecCCCCCccccCccc--cCCCEEEEEeCCCCcCCccccCCcc
Q 002446 108 RVLLLGYRSGFQVWDVEEADNVHDLVSRYDGPVSFMQMLPRPITSKRSRDKFA--EVRPLLVFCADGSRSCGTKVQDGLA 185 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~~~~~elvS~~dG~Vr~v~~lP~P~~~~~~~d~F~--~~rPLLAvv~~g~~~g~~~~~Dg~~ 185 (921)
-+++-|..+-+-|-|.-.. .....+..|...|..+++.|.|... |.|. ...++||+...
T Consensus 27 GLiAygshslV~VVDs~s~-q~iqsie~h~s~V~~VrWap~~~p~----~llS~~~~~lliAsaD~-------------- 87 (1062)
T KOG1912|consen 27 GLIAYGSHSLVSVVDSRSL-QLIQSIELHQSAVTSVRWAPAPSPR----DLLSPSSSQLLIASADI-------------- 87 (1062)
T ss_pred ceEEEecCceEEEEehhhh-hhhhccccCccceeEEEeccCCCch----hccCccccceeEEeccc--------------
Confidence 4788888888888888774 2334567788999999999887532 3343 23455654432
Q ss_pred cccCCCCCCcCCCCCCCCCCcEEEEEECCCCcEEEEEeCC-CCEEEEEE------cCCEEEE-EeCCEEEEEECCCCcEE
Q 002446 186 TACNGTSANYHDLGNGSSVPTVVHFYSLRSQSYVHMLKFR-SPIYSVRC------SSRVVAI-CQAAQVHCFDAATLEIE 257 (921)
Q Consensus 186 ~~~~g~~~~~h~~g~~~~~~~tVrIWDL~Tg~~V~tL~f~-s~V~sV~~------S~riLAV-a~d~~I~IwDl~T~~~l 257 (921)
.+.|-+||...+..+..|+.+ .+|.++.+ |+.+|++ .....|.+|+..||++.
T Consensus 88 -------------------~GrIil~d~~~~s~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLwntdtG~k~ 148 (1062)
T KOG1912|consen 88 -------------------SGRIILVDFVLASVINWLSHSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLWNTDTGEKF 148 (1062)
T ss_pred -------------------cCcEEEEEehhhhhhhhhcCCCcchhheeeeeccCcchheeEEecCCcEEEEEEccCCcee
Confidence 156899999999998888874 58888888 3455554 67789999999999988
Q ss_pred EEEec
Q 002446 258 YAILT 262 (921)
Q Consensus 258 ~tL~t 262 (921)
+....
T Consensus 149 Wk~~y 153 (1062)
T KOG1912|consen 149 WKYDY 153 (1062)
T ss_pred ecccc
Confidence 77653
No 300
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=94.76 E-value=0.063 Score=63.03 Aligned_cols=95 Identities=22% Similarity=0.213 Sum_probs=66.4
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC-
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR- 490 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D- 490 (921)
.=+.+.|||-|+||+|--..| |.+|--... . .++|=.|+ .|+-+.|||+.+||++=|--
T Consensus 212 Tetyv~wSP~GTYL~t~Hk~G--I~lWGG~~f--------------~---r~~RF~Hp-~Vq~idfSP~EkYLVT~s~~p 271 (698)
T KOG2314|consen 212 TETYVRWSPKGTYLVTFHKQG--IALWGGESF--------------D---RIQRFYHP-GVQFIDFSPNEKYLVTYSPEP 271 (698)
T ss_pred eeeeEEecCCceEEEEEeccc--eeeecCccH--------------H---HHHhccCC-CceeeecCCccceEEEecCCc
Confidence 346799999999999988887 789943321 1 22232232 39999999999999987642
Q ss_pred ----------CcEEEEecCCCCCceeecCCCCCcccccCCcCCccccCCCCC
Q 002446 491 ----------GTSHLFAINPLGGSVNFQPTDANFTTKHGAMAKSGVRWPPNL 532 (921)
Q Consensus 491 ----------gTVhVWdi~~~g~~~~l~~H~~~~~~~~~~~~~~~~r~~~~s 532 (921)
..+.||||.++....++..- ....+.-+.|||+..-
T Consensus 272 ~~~~~~d~e~~~l~IWDI~tG~lkrsF~~~------~~~~~~WP~frWS~Dd 317 (698)
T KOG2314|consen 272 IIVEEDDNEGQQLIIWDIATGLLKRSFPVI------KSPYLKWPIFRWSHDD 317 (698)
T ss_pred cccCcccCCCceEEEEEccccchhcceecc------CCCccccceEEeccCC
Confidence 46899999998666666432 2234555677887654
No 301
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=94.64 E-value=0.12 Score=61.77 Aligned_cols=77 Identities=18% Similarity=0.301 Sum_probs=60.4
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe-cccccccEEEEEEccCCCEEEEEeCC
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ-RGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~-RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
.|-.+-|+|.=.++|++-.+|. +-|..+.- +.++++. +|... ..++||.|||+.||+|-.|
T Consensus 22 ~i~~~ewnP~~dLiA~~t~~ge-lli~R~n~---------------qRlwtip~p~~~v--~~sL~W~~DGkllaVg~kd 83 (665)
T KOG4640|consen 22 NIKRIEWNPKMDLIATRTEKGE-LLIHRLNW---------------QRLWTIPIPGENV--TASLCWRPDGKLLAVGFKD 83 (665)
T ss_pred ceEEEEEcCccchhheeccCCc-EEEEEecc---------------ceeEeccCCCCcc--ceeeeecCCCCEEEEEecC
Confidence 4666889999999999999997 55666552 3456665 44321 2499999999999999999
Q ss_pred CcEEEEecCCCCCcee
Q 002446 491 GTSHLFAINPLGGSVN 506 (921)
Q Consensus 491 gTVhVWdi~~~g~~~~ 506 (921)
|||+|-|+.+++....
T Consensus 84 G~I~L~Dve~~~~l~~ 99 (665)
T KOG4640|consen 84 GTIRLHDVEKGGRLVS 99 (665)
T ss_pred CeEEEEEccCCCceec
Confidence 9999999999877665
No 302
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=94.63 E-value=0.12 Score=63.08 Aligned_cols=94 Identities=20% Similarity=0.213 Sum_probs=69.8
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
+=+.+.|.|.+++....- .+...|... +-+|.++||||.||+ +.|..+.+. ...+.+.+
T Consensus 53 ~~GtH~g~v~~~~~~~~~--~~~~~~s~~------~~~Gey~asCS~DGk-v~I~sl~~~------------~~~~~~df 111 (846)
T KOG2066|consen 53 ALGTHRGAVYLTTCQGNP--KTNFDHSSS------ILEGEYVASCSDDGK-VVIGSLFTD------------DEITQYDF 111 (846)
T ss_pred eeccccceEEEEecCCcc--ccccccccc------ccCCceEEEecCCCc-EEEeeccCC------------ccceeEec
Confidence 345678999999876542 455566554 789999999999998 788887764 22345677
Q ss_pred ecccccccEEEEEEccC-----CCEEEEEeCCCcEEEEecCCCCCc
Q 002446 464 QRGLTNAVIQDISFSDD-----SNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPD-----g~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
+| .|.+|+++|| ++.+++|+..| +.++.-+=.|..
T Consensus 112 ~r-----piksial~Pd~~~~~sk~fv~GG~ag-lvL~er~wlgnk 151 (846)
T KOG2066|consen 112 KR-----PIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNWLGNK 151 (846)
T ss_pred CC-----cceeEEeccchhhhhhhheeecCcce-EEEehhhhhcCc
Confidence 65 3889999999 88899999999 878765444433
No 303
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=94.44 E-value=0.62 Score=54.72 Aligned_cols=51 Identities=12% Similarity=0.142 Sum_probs=41.5
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEcC--CEEEEEeCC----EEEEEECCCCcE
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCSS--RVVAICQAA----QVHCFDAATLEI 256 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~--riLAVa~d~----~I~IwDl~T~~~ 256 (921)
..+.++|+.+++....+.|+..-..-+|++ +.||.+..+ .|+++|+.+.+.
T Consensus 218 ~~i~~~~l~~g~~~~i~~~~g~~~~P~fspDG~~l~f~~~rdg~~~iy~~dl~~~~~ 274 (425)
T COG0823 218 PRIYYLDLNTGKRPVILNFNGNNGAPAFSPDGSKLAFSSSRDGSPDIYLMDLDGKNL 274 (425)
T ss_pred ceEEEEeccCCccceeeccCCccCCccCCCCCCEEEEEECCCCCccEEEEcCCCCcc
Confidence 468899999999988888888777888874 777776543 899999998773
No 304
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=94.37 E-value=0.11 Score=58.32 Aligned_cols=105 Identities=14% Similarity=0.194 Sum_probs=72.2
Q ss_pred ccCCCCEEEEEECCCC----ceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 385 DADNVGMVIVRDIVSK----NVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~----~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
.+...|.|.++|+..+ .-.++---|.++|++|..=. ++++|++.+-+|+ |++||..--..+ .-
T Consensus 269 ~GcRngeI~~iDLR~rnqG~~~~a~rlyh~Ssvtslq~Lq~s~q~LmaS~M~gk-ikLyD~R~~K~~-----------~~ 336 (425)
T KOG2695|consen 269 NGCRNGEIFVIDLRCRNQGNGWCAQRLYHDSSVTSLQILQFSQQKLMASDMTGK-IKLYDLRATKCK-----------KS 336 (425)
T ss_pred ecccCCcEEEEEeeecccCCCcceEEEEcCcchhhhhhhccccceEeeccCcCc-eeEeeehhhhcc-----------cc
Confidence 3567799999999865 23334446899999987666 8899999999998 999998753110 01
Q ss_pred EEEEeccccccc-EEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 460 LYRLQRGLTNAV-IQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 460 l~~l~RG~t~a~-I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
+... .||.+.. -.-+-..+....++++++|--.+||.+..+.
T Consensus 337 V~qY-eGHvN~~a~l~~~v~~eeg~I~s~GdDcytRiWsl~~gh 379 (425)
T KOG2695|consen 337 VMQY-EGHVNLSAYLPAHVKEEEGSIFSVGDDCYTRIWSLDSGH 379 (425)
T ss_pred eeee-ecccccccccccccccccceEEEccCeeEEEEEecccCc
Confidence 2222 3543221 1122345677788889999999999998753
No 305
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=94.31 E-value=5.7 Score=45.67 Aligned_cols=57 Identities=7% Similarity=0.032 Sum_probs=42.4
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEE-EEE-cCCEEEEEeCCEEEEEECCCCcEEEEEec
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYS-VRC-SSRVVAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~s-V~~-S~riLAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
+.|.-+|.+||+.+-+.+....+.+ ..+ ..++++...+++|+.+|+.|++.+++...
T Consensus 130 g~l~ald~~tG~~~W~~~~~~~~~ssP~v~~~~v~v~~~~g~l~ald~~tG~~~W~~~~ 188 (394)
T PRK11138 130 GQVYALNAEDGEVAWQTKVAGEALSRPVVSDGLVLVHTSNGMLQALNESDGAVKWTVNL 188 (394)
T ss_pred CEEEEEECCCCCCcccccCCCceecCCEEECCEEEEECCCCEEEEEEccCCCEeeeecC
Confidence 5688899999999888877655442 122 34444446678999999999999988764
No 306
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=94.02 E-value=0.28 Score=53.94 Aligned_cols=72 Identities=19% Similarity=0.299 Sum_probs=48.6
Q ss_pred EEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEE
Q 002446 416 LCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHL 495 (921)
Q Consensus 416 LaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhV 495 (921)
++.+.||++||.--+ +.|-|=..... . ++........+. ....-+.++||||+..||.+.+.|||+|
T Consensus 3 ~~~~~~Gk~lAi~qd--~~iEiRsa~Dd-f---------~si~~kcqVpkD-~~PQWRkl~WSpD~tlLa~a~S~G~i~v 69 (282)
T PF15492_consen 3 LALSSDGKLLAILQD--QCIEIRSAKDD-F---------SSIIGKCQVPKD-PNPQWRKLAWSPDCTLLAYAESTGTIRV 69 (282)
T ss_pred eeecCCCcEEEEEec--cEEEEEeccCC-c---------hheeEEEecCCC-CCchheEEEECCCCcEEEEEcCCCeEEE
Confidence 678899999998543 34666555443 1 111111223222 2233778999999999999999999999
Q ss_pred EecCC
Q 002446 496 FAINP 500 (921)
Q Consensus 496 Wdi~~ 500 (921)
||+..
T Consensus 70 fdl~g 74 (282)
T PF15492_consen 70 FDLMG 74 (282)
T ss_pred Eeccc
Confidence 99854
No 307
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=93.77 E-value=0.11 Score=60.71 Aligned_cols=93 Identities=15% Similarity=0.253 Sum_probs=66.9
Q ss_pred EECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEE
Q 002446 395 RDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQD 474 (921)
Q Consensus 395 wDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~s 474 (921)
|.-.+...-..+.+-.-|+..++|||.|++|++....| |.+|+-... ..+.++ .+..|..
T Consensus 17 ~~~~s~~~~~~~~~~~~p~~~~~~SP~G~~l~~~~~~~--V~~~~g~~~--------------~~l~~~----~~~~V~~ 76 (561)
T COG5354 17 WNSQSEVIHTRFESENWPVAYVSESPLGTYLFSEHAAG--VECWGGPSK--------------AKLVRF----RHPDVKY 76 (561)
T ss_pred ecCccccccccccccCcchhheeecCcchheehhhccc--eEEccccch--------------hheeee----ecCCcee
Confidence 55455444455555677999999999999999987765 899976543 122233 2346999
Q ss_pred EEEccCCCEEEEEeCCCc---------------EEEEecCCCCCceee
Q 002446 475 ISFSDDSNWIMISSSRGT---------------SHLFAINPLGGSVNF 507 (921)
Q Consensus 475 IaFSPDg~~LAsgS~DgT---------------VhVWdi~~~g~~~~l 507 (921)
+.|||.++||.+=+.... +.|||+..+.-...+
T Consensus 77 ~~fSP~~kYL~tw~~~pi~~pe~e~sp~~~~n~~~vwd~~sg~iv~sf 124 (561)
T COG5354 77 LDFSPNEKYLVTWSREPIIEPEIEISPFTSKNNVFVWDIASGMIVFSF 124 (561)
T ss_pred cccCcccceeeeeccCCccChhhccCCccccCceeEEeccCceeEeec
Confidence 999999999999877665 888998775444444
No 308
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=93.65 E-value=0.37 Score=58.49 Aligned_cols=104 Identities=18% Similarity=0.231 Sum_probs=74.3
Q ss_pred cccCCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 384 PDADNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
++...+-.|..||+.+. .++-.+..-...-+.|+++- ++..||+ ..|+.|+|||+..+ + ..+.
T Consensus 131 atcsvdt~vh~wd~rSp~~p~ys~~~w~s~asqVkwnyk~p~vlas--shg~~i~vwd~r~g---s----------~pl~ 195 (1081)
T KOG0309|consen 131 ATCSVDTYVHAWDMRSPHRPFYSTSSWRSAASQVKWNYKDPNVLAS--SHGNDIFVWDLRKG---S----------TPLC 195 (1081)
T ss_pred eeccccccceeeeccCCCcceeeeecccccCceeeecccCcchhhh--ccCCceEEEeccCC---C----------cceE
Confidence 34455678999999886 35555554445667789987 6777765 56778999999886 1 2345
Q ss_pred EEecccccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCCCCc
Q 002446 462 RLQRGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
.+++ +.+.|+.++|.. .-..+.+.++||||+.|+.+.....
T Consensus 196 s~K~--~vs~vn~~~fnr~~~s~~~s~~~d~tvkfw~y~kSt~e 237 (1081)
T KOG0309|consen 196 SLKG--HVSSVNSIDFNRFKYSEIMSSSNDGTVKFWDYSKSTTE 237 (1081)
T ss_pred Eecc--cceeeehHHHhhhhhhhhcccCCCCceeeecccccccc
Confidence 6654 345699999954 4456788999999999999875443
No 309
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=93.58 E-value=0.96 Score=51.69 Aligned_cols=59 Identities=24% Similarity=0.318 Sum_probs=47.2
Q ss_pred ccccCCCCEEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
+.+++.|+.|+|-.+..--.+..|- +|+.-|+.|+.-++- +|+++|.|+| +++||+..+
T Consensus 166 IitaDRDEkIRvs~ypa~f~IesfclGH~eFVS~isl~~~~-~LlS~sGD~t-lr~Wd~~sg 225 (390)
T KOG3914|consen 166 IITADRDEKIRVSRYPATFVIESFCLGHKEFVSTISLTDNY-LLLSGSGDKT-LRLWDITSG 225 (390)
T ss_pred EEEecCCceEEEEecCcccchhhhccccHhheeeeeeccCc-eeeecCCCCc-EEEEecccC
Confidence 3456778888887666666666665 899999999998654 5999999998 899999987
No 310
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=93.24 E-value=0.22 Score=40.64 Aligned_cols=30 Identities=10% Similarity=0.298 Sum_probs=28.0
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
.+.|..++|||....||.++.||.|.||++
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl 40 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGEVLVYRL 40 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCeEEEEEC
Confidence 345999999999999999999999999999
No 311
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=93.15 E-value=9.7 Score=43.78 Aligned_cols=89 Identities=11% Similarity=0.031 Sum_probs=48.2
Q ss_pred CCEEEEEECCCCceEEEeccCCC-CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKS-PISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~-pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
+|.|..+|..+++.+.....-.. ..++... .+.+|..++.+|. +.++|..++ +.+++.+-+.
T Consensus 303 ~g~l~ald~~tG~~~W~~~~~~~~~~~sp~v--~~g~l~v~~~~G~-l~~ld~~tG--------------~~~~~~~~~~ 365 (394)
T PRK11138 303 NDRVYALDTRGGVELWSQSDLLHRLLTAPVL--YNGYLVVGDSEGY-LHWINREDG--------------RFVAQQKVDS 365 (394)
T ss_pred CCeEEEEECCCCcEEEcccccCCCcccCCEE--ECCEEEEEeCCCE-EEEEECCCC--------------CEEEEEEcCC
Confidence 45666666666665543321110 1111111 1445667888987 788898876 3344443221
Q ss_pred ccccEE-EEEEccCCCEEEEEeCCCcEEEEec
Q 002446 468 TNAVIQ-DISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 468 t~a~I~-sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
. .+. ...+ .+..|.+++.||+++.|++
T Consensus 366 ~--~~~s~P~~--~~~~l~v~t~~G~l~~~~~ 393 (394)
T PRK11138 366 S--GFLSEPVV--ADDKLLIQARDGTVYAITR 393 (394)
T ss_pred C--cceeCCEE--ECCEEEEEeCCceEEEEeC
Confidence 1 121 1122 2457888899999998875
No 312
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=93.11 E-value=0.18 Score=56.60 Aligned_cols=113 Identities=16% Similarity=0.195 Sum_probs=82.3
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.+-.|-+-|++++.. ..|. .++.|-++.|.-.+.++..+...|. |-+.|+.....|. .++...+.
T Consensus 232 ~sqqv~L~nvetg~~-qsf~-sksDVfAlQf~~s~nLv~~GcRnge-I~~iDLR~rnqG~---------~~~a~rly--- 296 (425)
T KOG2695|consen 232 LSQQVLLTNVETGHQ-QSFQ-SKSDVFALQFAGSDNLVFNGCRNGE-IFVIDLRCRNQGN---------GWCAQRLY--- 296 (425)
T ss_pred ccceeEEEEeecccc-cccc-cchhHHHHHhcccCCeeEecccCCc-EEEEEeeecccCC---------CcceEEEE---
Confidence 345677788887743 3454 5678999999999999999999997 7899998752222 34444453
Q ss_pred ccccEEEEEEcc-CCCEEEEEeCCCcEEEEecCCCCC---ceeecCCCCCcc
Q 002446 468 TNAVIQDISFSD-DSNWIMISSSRGTSHLFAINPLGG---SVNFQPTDANFT 515 (921)
Q Consensus 468 t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~~g~---~~~l~~H~~~~~ 515 (921)
+...|+++..=. ++++|.+++++|+|++||+.-.+. .....+|.+...
T Consensus 297 h~Ssvtslq~Lq~s~q~LmaS~M~gkikLyD~R~~K~~~~V~qYeGHvN~~a 348 (425)
T KOG2695|consen 297 HDSSVTSLQILQFSQQKLMASDMTGKIKLYDLRATKCKKSVMQYEGHVNLSA 348 (425)
T ss_pred cCcchhhhhhhccccceEeeccCcCceeEeeehhhhcccceeeeeccccccc
Confidence 233477777655 789999999999999999987666 556678865433
No 313
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=93.10 E-value=0.9 Score=59.19 Aligned_cols=115 Identities=11% Similarity=0.051 Sum_probs=67.5
Q ss_pred ccCCCCEEEEEECCCCceEEEeccC---------------CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCC
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAH---------------KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSS 449 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH---------------~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s 449 (921)
+....+.|++||..++... .+.+. -.....|+|+|||+.|..++.+.+.|++||+.++......
T Consensus 700 ad~~~~~I~v~d~~~g~v~-~~~G~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~Irv~D~~tg~~~~~~ 778 (1057)
T PLN02919 700 AMAGQHQIWEYNISDGVTR-VFSGDGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSSIRALDLKTGGSRLLA 778 (1057)
T ss_pred EECCCCeEEEEECCCCeEE-EEecCCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCeEEEEECCCCcEEEEE
Confidence 3345678999998776542 22211 1234569999999977777666567999998864100000
Q ss_pred ccCCCCceeEEEEEec--cc----ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCC
Q 002446 450 ACDAGTSYVHLYRLQR--GL----TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPL 501 (921)
Q Consensus 450 ~~~~~~~~~~l~~l~R--G~----t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~ 501 (921)
.++.. ....++.+-. |. .-.....|+|++||+.+++-+.+++|++||..+.
T Consensus 779 gg~~~-~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs~N~rIrviD~~tg 835 (1057)
T PLN02919 779 GGDPT-FSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADSYNHKIKKLDPATK 835 (1057)
T ss_pred ecccc-cCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEECCCCEEEEEECCCC
Confidence 00000 0000011100 00 0011468999999999999999999999998753
No 314
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=92.85 E-value=0.26 Score=59.65 Aligned_cols=101 Identities=10% Similarity=0.160 Sum_probs=73.6
Q ss_pred CCCCEEEEEECCCCceEE-EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 387 DNVGMVIVRDIVSKNVIA-QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~-~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
...|.|.+|.-..+.... ...+-.+.+..++.|++..+.|.|+..|. |-||.+....+. ..+| +.+
T Consensus 52 sS~G~lyl~~R~~~~~~~~~~~~~~~~~~~~~vs~~e~lvAagt~~g~-V~v~ql~~~~p~-----------~~~~-~t~ 118 (726)
T KOG3621|consen 52 SSAGSVYLYNRHTGEMRKLKNEGATGITCVRSVSSVEYLVAAGTASGR-VSVFQLNKELPR-----------DLDY-VTP 118 (726)
T ss_pred cccceEEEEecCchhhhcccccCccceEEEEEecchhHhhhhhcCCce-EEeehhhccCCC-----------ccee-ecc
Confidence 456899999877665322 22234556777899999999998888886 899988764111 1222 223
Q ss_pred ccc--cccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 466 GLT--NAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 466 G~t--~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
++. ..+|++++||+|++.|.+|-+.|+|+.-.++.
T Consensus 119 ~d~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s 155 (726)
T KOG3621|consen 119 CDKSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDS 155 (726)
T ss_pred ccccCCceEEEEEecccccEEeecCCCceEEEEEech
Confidence 333 44699999999999999999999999988876
No 315
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=92.79 E-value=0.23 Score=55.68 Aligned_cols=81 Identities=27% Similarity=0.331 Sum_probs=56.1
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc--------------ccccEEEEE
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL--------------TNAVIQDIS 476 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~--------------t~a~I~sIa 476 (921)
.-|+++.|+.+|.+||||+.+|+ +-+|.-..... +.|.++... -.-+|..|.
T Consensus 26 diis~vef~~~Ge~LatGdkgGR-Vv~f~r~~~~~-------------~ey~~~t~fqshepEFDYLkSleieEKinkIr 91 (433)
T KOG1354|consen 26 DIISAVEFDHYGERLATGDKGGR-VVLFEREKLYK-------------GEYNFQTEFQSHEPEFDYLKSLEIEEKINKIR 91 (433)
T ss_pred cceeeEEeecccceEeecCCCCe-EEEeecccccc-------------cceeeeeeeeccCcccchhhhhhhhhhhhhce
Confidence 35899999999999999999998 67885443200 011111110 112488999
Q ss_pred EccCCC--EEEEEeCCCcEEEEecCCCCCce
Q 002446 477 FSDDSN--WIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 477 FSPDg~--~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
|.+++. .+...+.|.||++|.+...+...
T Consensus 92 w~~~~n~a~FLlstNdktiKlWKi~er~~k~ 122 (433)
T KOG1354|consen 92 WLDDGNLAEFLLSTNDKTIKLWKIRERGSKK 122 (433)
T ss_pred ecCCCCccEEEEecCCcceeeeeeecccccc
Confidence 988765 57788899999999998754433
No 316
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=92.63 E-value=0.2 Score=60.34 Aligned_cols=98 Identities=15% Similarity=0.237 Sum_probs=71.4
Q ss_pred cccCCCCEEEEEECCCC---------------ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCC
Q 002446 384 PDADNVGMVIVRDIVSK---------------NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTS 448 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~---------------~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~ 448 (921)
+-++.+|.++|..+.+. ..-.++.+|+..|.-+.|+-+.+.|-|.+.+| .|.||-+-.+ .+.
T Consensus 30 AcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt~G-lIiVWmlykg-sW~- 106 (1189)
T KOG2041|consen 30 ACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDTSG-LIIVWMLYKG-SWC- 106 (1189)
T ss_pred EeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCCCc-eEEEEeeecc-cHH-
Confidence 34556777777765432 12346789999999999999999999999998 5899988765 111
Q ss_pred CccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEE
Q 002446 449 SACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLF 496 (921)
Q Consensus 449 s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVW 496 (921)
..+.. .| ....|.+++|..||+.+++.-.||.|.|=
T Consensus 107 ---------EEMiN-nR--nKSvV~SmsWn~dG~kIcIvYeDGavIVG 142 (1189)
T KOG2041|consen 107 ---------EEMIN-NR--NKSVVVSMSWNLDGTKICIVYEDGAVIVG 142 (1189)
T ss_pred ---------HHHhh-Cc--CccEEEEEEEcCCCcEEEEEEccCCEEEE
Confidence 11111 12 23459999999999999999999887653
No 317
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=92.34 E-value=4.1 Score=43.97 Aligned_cols=43 Identities=19% Similarity=0.111 Sum_probs=37.4
Q ss_pred EEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCcEEEEEec
Q 002446 220 HMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 220 ~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
..|++.+...++.+...+|.+..++.|.||++.++++++++..
T Consensus 223 ~~i~W~~~p~~~~~~~pyli~~~~~~iEV~~~~~~~lvQ~i~~ 265 (275)
T PF00780_consen 223 STIQWSSAPQSVAYSSPYLIAFSSNSIEVRSLETGELVQTIPL 265 (275)
T ss_pred cEEEcCCchhEEEEECCEEEEECCCEEEEEECcCCcEEEEEEC
Confidence 4788888888999988888887788999999999999998864
No 318
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=91.90 E-value=0.5 Score=52.24 Aligned_cols=104 Identities=13% Similarity=0.125 Sum_probs=69.5
Q ss_pred cccCCCCEEEEEECC-CCceEEE-eccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 384 PDADNVGMVIVRDIV-SKNVIAQ-FRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~-s~~~l~~-~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
-+++.||.+.-||+. .++.+.+ .+-|+..|.++.=|| .+++++||+.|-+ |++||+..- .+.+
T Consensus 182 ytGgDD~~l~~~D~R~p~~~i~~n~kvH~~GV~SI~ss~~~~~~I~TGsYDe~-i~~~DtRnm-------------~kPl 247 (339)
T KOG0280|consen 182 YTGGDDGSLSCWDIRIPKTFIWHNSKVHTSGVVSIYSSPPKPTYIATGSYDEC-IRVLDTRNM-------------GKPL 247 (339)
T ss_pred EecCCCceEEEEEecCCcceeeecceeeecceEEEecCCCCCceEEEeccccc-eeeeehhcc-------------cCcc
Confidence 367889999999998 4445544 678999999998887 6999999999976 999999842 1112
Q ss_pred EEEecccccccEEEEEEccCCC-EEEEEeCCCcEEEEecCCCCCc
Q 002446 461 YRLQRGLTNAVIQDISFSDDSN-WIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~-~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
+.-. ...-|+-|.++|--. .|..+.+-.-.+|-+++.....
T Consensus 248 ~~~~---v~GGVWRi~~~p~~~~~lL~~CMh~G~ki~~~~~~~~e 289 (339)
T KOG0280|consen 248 FKAK---VGGGVWRIKHHPEIFHRLLAACMHNGAKILDSSDKVLE 289 (339)
T ss_pred ccCc---cccceEEEEecchhhhHHHHHHHhcCceEEEecccccc
Confidence 2111 112267777777432 3334445555677777654443
No 319
>PRK02888 nitrous-oxide reductase; Validated
Probab=91.79 E-value=1.6 Score=53.25 Aligned_cols=114 Identities=12% Similarity=0.112 Sum_probs=67.0
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEe---cCCCE-----------EEEEeCCCCC----CCC
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTAS---VQGHN-----------INIFKIIPGI----LGT 447 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS---~DGt~-----------IrIWdi~~g~----~~~ 447 (921)
....+++.+.|..+.++..++.--. .-..++|+|||+++.+++ ..|.. +.+|++.... .|.
T Consensus 211 ~ey~~~vSvID~etmeV~~qV~Vdg-npd~v~~spdGk~afvTsyNsE~G~tl~em~a~e~d~~vvfni~~iea~vkdGK 289 (635)
T PRK02888 211 KKYRSLFTAVDAETMEVAWQVMVDG-NLDNVDTDYDGKYAFSTCYNSEEGVTLAEMMAAERDWVVVFNIARIEEAVKAGK 289 (635)
T ss_pred cceeEEEEEEECccceEEEEEEeCC-CcccceECCCCCEEEEeccCcccCcceeeeccccCceEEEEchHHHHHhhhCCC
Confidence 3456889999999988888876433 235578999999998875 32221 2333332100 000
Q ss_pred C--------CccCCCC----ceeEEEEEecccccccEEEEEEccCCCEEEEEeC-CCcEEEEecCCCCC
Q 002446 448 S--------SACDAGT----SYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS-RGTSHLFAINPLGG 503 (921)
Q Consensus 448 ~--------s~~~~~~----~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~~g~ 503 (921)
. +.-+... ....++.+.-| .....|++||||+|+.+++. +.||.|.|+.+...
T Consensus 290 ~~~V~gn~V~VID~~t~~~~~~~v~~yIPVG---KsPHGV~vSPDGkylyVanklS~tVSVIDv~k~k~ 355 (635)
T PRK02888 290 FKTIGGSKVPVVDGRKAANAGSALTRYVPVP---KNPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLDD 355 (635)
T ss_pred EEEECCCEEEEEECCccccCCcceEEEEECC---CCccceEECCCCCEEEEeCCCCCcEEEEEChhhhh
Confidence 0 0000000 00122223222 22568999999999887665 89999999988543
No 320
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=91.67 E-value=0.5 Score=56.65 Aligned_cols=58 Identities=17% Similarity=0.376 Sum_probs=48.5
Q ss_pred cccCCCCEEEEEECCCCceEEEeccCCCCeE-EEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 384 PDADNVGMVIVRDIVSKNVIAQFRAHKSPIS-ALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 384 ~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIs-aLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
+....+|.|.++-+. -+.+.+|.-|..+++ ++||.|||++||.|=.||+ |+|-|+..+
T Consensus 36 A~~t~~gelli~R~n-~qRlwtip~p~~~v~~sL~W~~DGkllaVg~kdG~-I~L~Dve~~ 94 (665)
T KOG4640|consen 36 ATRTEKGELLIHRLN-WQRLWTIPIPGENVTASLCWRPDGKLLAVGFKDGT-IRLHDVEKG 94 (665)
T ss_pred heeccCCcEEEEEec-cceeEeccCCCCccceeeeecCCCCEEEEEecCCe-EEEEEccCC
Confidence 444567878887776 566788887877887 9999999999999999998 999999986
No 321
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=91.49 E-value=17 Score=43.40 Aligned_cols=57 Identities=11% Similarity=0.069 Sum_probs=39.3
Q ss_pred cEEEEEECCCCcEEEEEeCCCC-------E--EEEEE-c-CCEEEEEeCCEEEEEECCCCcEEEEEec
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSP-------I--YSVRC-S-SRVVAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~-------V--~sV~~-S-~riLAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
+.|.-.|++||+.+-+.+.... + ..+.. . .++++...++.|+.+|+.|++.++....
T Consensus 71 g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~~~~~V~v~~~~g~v~AlD~~TG~~~W~~~~ 138 (488)
T cd00216 71 SALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYWDPRKVFFGTFDGRLVALDAETGKQVWKFGN 138 (488)
T ss_pred CcEEEEECCCChhhceeCCCCCccccccccccCCcEEccCCeEEEecCCCeEEEEECCCCCEeeeecC
Confidence 4577779999988877655322 1 11223 3 4555557789999999999999988754
No 322
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=91.42 E-value=29 Score=39.23 Aligned_cols=71 Identities=20% Similarity=0.333 Sum_probs=48.6
Q ss_pred CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe
Q 002446 409 HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS 488 (921)
Q Consensus 409 H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS 488 (921)
-.+.|-+|+|+++|.++|..|-.|..+.+||..++ ..+-. ..-..+..++-.+++ |+++++
T Consensus 215 l~~Y~gSIa~~~~g~~ia~tsPrGg~~~~~d~~tg--------------~~~~~----~~l~D~cGva~~~~~-f~~ssG 275 (305)
T PF07433_consen 215 LNGYIGSIAADRDGRLIAVTSPRGGRVAVWDAATG--------------RLLGS----VPLPDACGVAPTDDG-FLVSSG 275 (305)
T ss_pred hCCceEEEEEeCCCCEEEEECCCCCEEEEEECCCC--------------CEeec----cccCceeeeeecCCc-eEEeCC
Confidence 35789999999999999999988889999999987 12111 122346677777777 555543
Q ss_pred CCCcEEEEecCCC
Q 002446 489 SRGTSHLFAINPL 501 (921)
Q Consensus 489 ~DgTVhVWdi~~~ 501 (921)
.|. ++.+...
T Consensus 276 -~G~--~~~~~~~ 285 (305)
T PF07433_consen 276 -QGQ--LIRLSPD 285 (305)
T ss_pred -Ccc--EEEccCc
Confidence 343 5555544
No 323
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=91.07 E-value=0.14 Score=55.68 Aligned_cols=57 Identities=23% Similarity=0.279 Sum_probs=48.0
Q ss_pred ccCCCCEEEEEECCCCc-eEEEeccCCCCeEEEEECC-CCCEEEEEecCCCEEEEEeCCC
Q 002446 385 DADNVGMVIVRDIVSKN-VIAQFRAHKSPISALCFDP-SGILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~-~l~~~~aH~~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~ 442 (921)
.+..+|.|.|||..+.. +...+++|+.+|.-+-|.| ++..|.|||.||. +--||..+
T Consensus 197 cgt~dg~~~l~d~rn~~~p~S~l~ahk~~i~eV~FHpk~p~~Lft~sedGs-lw~wdas~ 255 (319)
T KOG4714|consen 197 CGTDDGIVGLWDARNVAMPVSLLKAHKAEIWEVHFHPKNPEHLFTCSEDGS-LWHWDAST 255 (319)
T ss_pred EecCCCeEEEEEcccccchHHHHHHhhhhhhheeccCCCchheeEecCCCc-EEEEcCCC
Confidence 45678999999999875 4556789999999999999 6899999999997 56777764
No 324
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=90.96 E-value=0.34 Score=56.48 Aligned_cols=97 Identities=18% Similarity=0.282 Sum_probs=72.5
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEcc--
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSD-- 479 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSP-- 479 (921)
+...|..|.+-|..|-|+..|+.|+++|+|-+ |-+||...+ .....+.-||... |..-.|=|
T Consensus 134 l~~kL~~H~GcVntV~FN~~Gd~l~SgSDD~~-vv~WdW~~~--------------~~~l~f~SGH~~N-vfQaKFiP~s 197 (559)
T KOG1334|consen 134 LQKKLNKHKGCVNTVHFNQRGDVLASGSDDLQ-VVVWDWVSG--------------SPKLSFESGHCNN-VFQAKFIPFS 197 (559)
T ss_pred hhhcccCCCCccceeeecccCceeeccCccce-EEeehhhcc--------------Ccccccccccccc-hhhhhccCCC
Confidence 44567899999999999999999999999975 889999875 2334566676554 44445755
Q ss_pred CCCEEEEEeCCCcEEEEecCCCCCce---eecCCCCCc
Q 002446 480 DSNWIMISSSRGTSHLFAINPLGGSV---NFQPTDANF 514 (921)
Q Consensus 480 Dg~~LAsgS~DgTVhVWdi~~~g~~~---~l~~H~~~~ 514 (921)
+.+-+++.+.||-|++=.+...+... .+..|.+.+
T Consensus 198 ~d~ti~~~s~dgqvr~s~i~~t~~~e~t~rl~~h~g~v 235 (559)
T KOG1334|consen 198 GDRTIVTSSRDGQVRVSEILETGYVENTKRLAPHEGPV 235 (559)
T ss_pred CCcCceeccccCceeeeeeccccceecceecccccCcc
Confidence 55779999999999998887665543 334555443
No 325
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=90.94 E-value=0.48 Score=52.60 Aligned_cols=103 Identities=17% Similarity=0.249 Sum_probs=68.1
Q ss_pred ccccCCCCEEEEEECCCCc----------------eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCC
Q 002446 383 FPDADNVGMVIVRDIVSKN----------------VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILG 446 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~----------------~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~ 446 (921)
+.-....|.|++-|+.... .+.-|.+-.+.|+.+.|+++|+++++-+.- .++|||+....
T Consensus 237 fmYSsSkG~Ikl~DlRq~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~ngryIlsRdyl--tvkiwDvnm~k-- 312 (460)
T COG5170 237 FMYSSSKGEIKLNDLRQSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSDNGRYILSRDYL--TVKIWDVNMAK-- 312 (460)
T ss_pred EEEecCCCcEEehhhhhhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcCCCcEEEEeccc--eEEEEeccccc--
Confidence 3334456889999987321 112233445789999999999999987665 49999998641
Q ss_pred CCCccCCCCceeEEEEE--ec--------cc-ccc--cEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 447 TSSACDAGTSYVHLYRL--QR--------GL-TNA--VIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 447 ~~s~~~~~~~~~~l~~l--~R--------G~-t~a--~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.++++. +. -. ..| .=..|.||-|.+.+.+||-.+..-|+...+
T Consensus 313 -----------~pikTi~~h~~l~~~l~d~YEnDaifdkFeisfSgd~~~v~sgsy~NNfgiyp~~s 368 (460)
T COG5170 313 -----------NPIKTIPMHCDLMDELNDVYENDAIFDKFEISFSGDDKHVLSGSYSNNFGIYPTDS 368 (460)
T ss_pred -----------CCceeechHHHHHHHHHhhhhccceeeeEEEEecCCcccccccccccceeeecccc
Confidence 112211 00 00 011 124689999999999999999888887554
No 326
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=90.80 E-value=39 Score=39.60 Aligned_cols=48 Identities=17% Similarity=0.331 Sum_probs=39.9
Q ss_pred CcEEEEEECCCCcEEEEEeCC-CCEEEEEEc--CCEEEEEeCCEEEEEECCC
Q 002446 205 PTVVHFYSLRSQSYVHMLKFR-SPIYSVRCS--SRVVAICQAAQVHCFDAAT 253 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f~-s~V~sV~~S--~riLAVa~d~~I~IwDl~T 253 (921)
|..|+||+. .|+.+.++.++ +.|..+.|+ .++|+|..++.+++||+..
T Consensus 60 p~~I~iys~-sG~ll~~i~w~~~~iv~~~wt~~e~LvvV~~dG~v~vy~~~G 110 (410)
T PF04841_consen 60 PNSIQIYSS-SGKLLSSIPWDSGRIVGMGWTDDEELVVVQSDGTVRVYDLFG 110 (410)
T ss_pred CcEEEEECC-CCCEeEEEEECCCCEEEEEECCCCeEEEEEcCCEEEEEeCCC
Confidence 347999997 57788888885 689999996 4778889999999999873
No 327
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=90.17 E-value=0.91 Score=54.21 Aligned_cols=58 Identities=17% Similarity=0.270 Sum_probs=47.2
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
++-+..||.|++||...+. .++..+.-..+.++|+|+|.++++|+..|. +.+||+.-.
T Consensus 274 LvlGC~DgSiiLyD~~~~~--t~~~ka~~~P~~iaWHp~gai~~V~s~qGe-lQ~FD~ALs 331 (545)
T PF11768_consen 274 LVLGCEDGSIILYDTTRGV--TLLAKAEFIPTLIAWHPDGAIFVVGSEQGE-LQCFDMALS 331 (545)
T ss_pred EEEEecCCeEEEEEcCCCe--eeeeeecccceEEEEcCCCcEEEEEcCCce-EEEEEeecC
Confidence 3456789999999987763 334445566788999999999999999997 899999875
No 328
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=90.05 E-value=0.86 Score=52.86 Aligned_cols=115 Identities=16% Similarity=0.184 Sum_probs=77.1
Q ss_pred CCCEEEEEECCCCc-eEEEec-cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC-CC-CCCCccCCCCceeEEEEE
Q 002446 388 NVGMVIVRDIVSKN-VIAQFR-AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG-IL-GTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 388 ~~G~V~IwDl~s~~-~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g-~~-~~~s~~~~~~~~~~l~~l 463 (921)
..|.|.|+|-.... .+..++ -|.+||.++.++|-|...++.+..| +|.-|..... .. ..--.... ..-..+|.+
T Consensus 120 ~sg~i~VvD~~~d~~q~~~fkklH~sPV~~i~y~qa~Ds~vSiD~~g-mVEyWs~e~~~qfPr~~l~~~~-K~eTdLy~f 197 (558)
T KOG0882|consen 120 KSGKIFVVDGFGDFCQDGYFKKLHFSPVKKIRYNQAGDSAVSIDISG-MVEYWSAEGPFQFPRTNLNFEL-KHETDLYGF 197 (558)
T ss_pred cCCCcEEECCcCCcCccceecccccCceEEEEeeccccceeeccccc-eeEeecCCCcccCccccccccc-cccchhhcc
Confidence 45788999876543 344444 7999999999999999999988887 5999988741 00 00000000 000112322
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCcee
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVN 506 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~ 506 (921)
..- .....++.|||+|..+++-+.|.+|++|+..++.-...
T Consensus 198 ~K~--Kt~pts~Efsp~g~qistl~~DrkVR~F~~KtGklvqe 238 (558)
T KOG0882|consen 198 PKA--KTEPTSFEFSPDGAQISTLNPDRKVRGFVFKTGKLVQE 238 (558)
T ss_pred ccc--ccCccceEEccccCcccccCcccEEEEEEeccchhhhh
Confidence 211 12378999999999999999999999999987644333
No 329
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=89.30 E-value=0.43 Score=52.02 Aligned_cols=95 Identities=14% Similarity=0.245 Sum_probs=61.7
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
+..++|+++-.+.+..-+.-...|++++-.|.-+ ++++|+.|| .+-|||.... .-. .-++. . +
T Consensus 159 d~~~a~~~~p~~t~~~~~~~~~~v~~l~~hp~qq~~v~cgt~dg-~~~l~d~rn~-~~p----------~S~l~---a-h 222 (319)
T KOG4714|consen 159 DNFYANTLDPIKTLIPSKKALDAVTALCSHPAQQHLVCCGTDDG-IVGLWDARNV-AMP----------VSLLK---A-H 222 (319)
T ss_pred cceeeecccccccccccccccccchhhhCCcccccEEEEecCCC-eEEEEEcccc-cch----------HHHHH---H-h
Confidence 4456677654332211111123499999999655 555566666 6999999864 100 01111 2 2
Q ss_pred cccEEEEEEcc-CCCEEEEEeCCCcEEEEecCC
Q 002446 469 NAVIQDISFSD-DSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 469 ~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi~~ 500 (921)
.+.|+.|-|.| ++..|.+++.||.+--||-++
T Consensus 223 k~~i~eV~FHpk~p~~Lft~sedGslw~wdas~ 255 (319)
T KOG4714|consen 223 KAEIWEVHFHPKNPEHLFTCSEDGSLWHWDAST 255 (319)
T ss_pred hhhhhheeccCCCchheeEecCCCcEEEEcCCC
Confidence 35699999998 788999999999999999875
No 330
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=89.05 E-value=1.2 Score=50.75 Aligned_cols=103 Identities=12% Similarity=0.173 Sum_probs=58.6
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.+.+.|||+.+++....... ...+....|||||+.||-.... .|.++++..+....-...+ ... ++ -|..
T Consensus 22 ~~~y~i~d~~~~~~~~l~~~-~~~~~~~~~sP~g~~~~~v~~~--nly~~~~~~~~~~~lT~dg-~~~---i~---nG~~ 91 (353)
T PF00930_consen 22 KGDYYIYDIETGEITPLTPP-PPKLQDAKWSPDGKYIAFVRDN--NLYLRDLATGQETQLTTDG-EPG---IY---NGVP 91 (353)
T ss_dssp EEEEEEEETTTTEEEESS-E-ETTBSEEEE-SSSTEEEEEETT--EEEEESSTTSEEEESES---TTT---EE---ESB-
T ss_pred ceeEEEEecCCCceEECcCC-ccccccceeecCCCeeEEEecC--ceEEEECCCCCeEEecccc-cee---EE---cCcc
Confidence 36799999999866443333 6789999999999999998753 5888887654110000000 000 00 0100
Q ss_pred --------cccEEEEEEccCCCEEEEEeC-CCcEEEEecCCC
Q 002446 469 --------NAVIQDISFSDDSNWIMISSS-RGTSHLFAINPL 501 (921)
Q Consensus 469 --------~a~I~sIaFSPDg~~LAsgS~-DgTVhVWdi~~~ 501 (921)
-..-..+-|||||++||.... +..|+.+.+..+
T Consensus 92 dwvyeEEv~~~~~~~~WSpd~~~la~~~~d~~~v~~~~~~~~ 133 (353)
T PF00930_consen 92 DWVYEEEVFDRRSAVWWSPDSKYLAFLRFDEREVPEYPLPDY 133 (353)
T ss_dssp -HHHHHHTSSSSBSEEE-TTSSEEEEEEEE-TTS-EEEEEEE
T ss_pred ceeccccccccccceEECCCCCEEEEEEECCcCCceEEeecc
Confidence 001135889999999998654 445666655443
No 331
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=88.86 E-value=0.21 Score=61.41 Aligned_cols=106 Identities=10% Similarity=0.146 Sum_probs=81.8
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCC-EEEEEeCCCCCCCCCCccCCCCceeEE
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGH-NINIFKIIPGILGTSSACDAGTSYVHL 460 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt-~IrIWdi~~g~~~~~s~~~~~~~~~~l 460 (921)
+++-+...|.|++|++.+|....+..+|.++|+.|.=+.||.++.|.|.-.. ..-+|++... ....
T Consensus 1115 hL~vG~~~Geik~~nv~sG~~e~s~ncH~SavT~vePs~dgs~~Ltsss~S~PlsaLW~~~s~-------------~~~~ 1181 (1516)
T KOG1832|consen 1115 HLAVGSHAGEIKIFNVSSGSMEESVNCHQSAVTLVEPSVDGSTQLTSSSSSSPLSALWDASST-------------GGPR 1181 (1516)
T ss_pred eEEeeeccceEEEEEccCccccccccccccccccccccCCcceeeeeccccCchHHHhccccc-------------cCcc
Confidence 5566678899999999999999999999999999999999999888765433 4568887652 1112
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCcee
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVN 506 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~ 506 (921)
+.+. + =.++.||...++=+.|+....++|||+.+.....+
T Consensus 1182 Hsf~-e-----d~~vkFsn~~q~r~~gt~~d~a~~YDvqT~~~l~t 1221 (1516)
T KOG1832|consen 1182 HSFD-E-----DKAVKFSNSLQFRALGTEADDALLYDVQTCSPLQT 1221 (1516)
T ss_pred cccc-c-----cceeehhhhHHHHHhcccccceEEEecccCcHHHH
Confidence 2332 2 23688998888888898888999999998644433
No 332
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=88.74 E-value=1.1 Score=36.59 Aligned_cols=31 Identities=16% Similarity=0.390 Sum_probs=27.7
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
..+|.+++|+|...+||.++.+|. |.||++.
T Consensus 11 ~~~v~~~~w~P~mdLiA~~t~~g~-v~v~Rl~ 41 (47)
T PF12894_consen 11 PSRVSCMSWCPTMDLIALGTEDGE-VLVYRLN 41 (47)
T ss_pred CCcEEEEEECCCCCEEEEEECCCe-EEEEECC
Confidence 357999999999999999999997 8999883
No 333
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=88.06 E-value=1.1 Score=51.08 Aligned_cols=57 Identities=26% Similarity=0.364 Sum_probs=45.1
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc----CCEEEEEe-CCEEEEEECCCCcEEEEEec
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS----SRVVAICQ-AAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S----~riLAVa~-d~~I~IwDl~T~~~l~tL~t 262 (921)
+.|=+||++|++.+..+....++.+|..+ +.++++.. ++.+.+||+.|++.+++++.
T Consensus 269 teVWv~D~~t~krv~Ri~l~~~~~Si~Vsqd~~P~L~~~~~~~~~l~v~D~~tGk~~~~~~~ 330 (342)
T PF06433_consen 269 TEVWVYDLKTHKRVARIPLEHPIDSIAVSQDDKPLLYALSAGDGTLDVYDAATGKLVRSIEQ 330 (342)
T ss_dssp EEEEEEETTTTEEEEEEEEEEEESEEEEESSSS-EEEEEETTTTEEEEEETTT--EEEEE--
T ss_pred eEEEEEECCCCeEEEEEeCCCccceEEEccCCCcEEEEEcCCCCeEEEEeCcCCcEEeehhc
Confidence 67888999999999999998889899997 35556654 57999999999999998864
No 334
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=88.02 E-value=22 Score=42.17 Aligned_cols=58 Identities=19% Similarity=0.289 Sum_probs=38.3
Q ss_pred CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 422 GILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 422 GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
|.+|+..+.+ .|.+||+.++ ..+.++. -..|..|.||+||+++|..+.+ ++.|++.+.
T Consensus 117 G~LL~~~~~~--~i~~yDw~~~--------------~~i~~i~----v~~vk~V~Ws~~g~~val~t~~-~i~il~~~~ 174 (443)
T PF04053_consen 117 GNLLGVKSSD--FICFYDWETG--------------KLIRRID----VSAVKYVIWSDDGELVALVTKD-SIYILKYNL 174 (443)
T ss_dssp SSSEEEEETT--EEEEE-TTT----------------EEEEES----S-E-EEEEE-TTSSEEEEE-S--SEEEEEE-H
T ss_pred CcEEEEECCC--CEEEEEhhHc--------------ceeeEEe----cCCCcEEEEECCCCEEEEEeCC-eEEEEEecc
Confidence 9999988776 4899999985 3344432 2238999999999999999865 788877643
No 335
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=87.82 E-value=0.62 Score=57.33 Aligned_cols=98 Identities=18% Similarity=0.269 Sum_probs=70.1
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG 466 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG 466 (921)
...|.|.|| +++|++-....- .-.+++|||.|.--.||.+=..|- +.+|...+. ..++..-
T Consensus 38 er~GSVtIf-adtGEPqr~Vt~-P~hatSLCWHpe~~vLa~gwe~g~-~~v~~~~~~---------------e~htv~~- 98 (1416)
T KOG3617|consen 38 ERGGSVTIF-ADTGEPQRDVTY-PVHATSLCWHPEEFVLAQGWEMGV-SDVQKTNTT---------------ETHTVVE- 98 (1416)
T ss_pred CCCceEEEE-ecCCCCCccccc-ceehhhhccChHHHHHhhccccce-eEEEecCCc---------------eeeeecc-
Confidence 345778887 345554332221 112456999999999999988885 899987763 2223322
Q ss_pred cccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCC
Q 002446 467 LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 467 ~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
.+.+.|+-+.|||||..+.++-.-|.+|+|.+.--|.
T Consensus 99 th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d~~g~ 135 (1416)
T KOG3617|consen 99 THPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYDVIGE 135 (1416)
T ss_pred CCCCCceeEEecCCCCeEEEcCCCceeEEEEeeeccc
Confidence 2457799999999999999999999999999875433
No 336
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=87.39 E-value=5 Score=38.76 Aligned_cols=65 Identities=17% Similarity=0.214 Sum_probs=44.6
Q ss_pred eEEEEEC---CCC-CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEe
Q 002446 413 ISALCFD---PSG-ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISS 488 (921)
Q Consensus 413 IsaLaFS---PdG-tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS 488 (921)
|++|++. -|| .-|+.||+|.. ||||+-.. .++++.. ...|++++-... ..||-+.
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D~~-IRvf~~~e----------------~~~Ei~e---~~~v~~L~~~~~-~~F~Y~l 60 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDDFE-IRVFKGDE----------------IVAEITE---TDKVTSLCSLGG-GRFAYAL 60 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCCcE-EEEEeCCc----------------EEEEEec---ccceEEEEEcCC-CEEEEEe
Confidence 4555544 454 36888999975 99998653 3445432 245888877776 5688888
Q ss_pred CCCcEEEEec
Q 002446 489 SRGTSHLFAI 498 (921)
Q Consensus 489 ~DgTVhVWdi 498 (921)
..|||-||+-
T Consensus 61 ~NGTVGvY~~ 70 (111)
T PF14783_consen 61 ANGTVGVYDR 70 (111)
T ss_pred cCCEEEEEeC
Confidence 9999887754
No 337
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=86.98 E-value=3.7 Score=50.17 Aligned_cols=241 Identities=15% Similarity=0.183 Sum_probs=123.5
Q ss_pred ccCCCCEEEEEECCCCceEEEec--cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEE--
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFR--AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHL-- 460 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~--aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l-- 460 (921)
+.+.+|.|.||-+-.+.=...+- ..++-|.+|+|+-||+.++.+-.||. |.|=.++-. .+
T Consensus 88 tSDt~GlIiVWmlykgsW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeDGa-vIVGsvdGN---------------RIwg 151 (1189)
T KOG2041|consen 88 TSDTSGLIIVWMLYKGSWCEEMINNRNKSVVVSMSWNLDGTKICIVYEDGA-VIVGSVDGN---------------RIWG 151 (1189)
T ss_pred ccCCCceEEEEeeecccHHHHHhhCcCccEEEEEEEcCCCcEEEEEEccCC-EEEEeeccc---------------eecc
Confidence 34667999999987765332222 44577899999999999998888886 434333321 11
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecCCCCCcccccCCcCCccccCCCCCCCCCCCCc
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQPTDANFTTKHGAMAKSGVRWPPNLGLQMPNQQ 540 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~H~~~~~~~~~~~~~~~~r~~~~s~l~~~~~~ 540 (921)
.+| .|.. ...+.||+|.+.+..+-..|.+|++|..-. ...+-|-+..+...|..-+ +.......+|..+.
T Consensus 152 KeL-kg~~---l~hv~ws~D~~~~Lf~~ange~hlydnqgn---F~~Kl~~~c~Vn~tg~~s~---~~~kia~i~w~~g~ 221 (1189)
T KOG2041|consen 152 KEL-KGQL---LAHVLWSEDLEQALFKKANGETHLYDNQGN---FERKLEKDCEVNGTGIFSN---FPTKIAEIEWNTGP 221 (1189)
T ss_pred hhc-chhe---ccceeecccHHHHHhhhcCCcEEEeccccc---HHHhhhhceEEeeeeeecC---CCccccceeeccCc
Confidence 122 2322 336789999999988888999999997531 2222222221111111110 11123344453333
Q ss_pred ccccCC-Ccee-----eeeeeEEecCCCCCCccccchhhhccC-----CccCCCcceeeeeeccCCCccccccCCccccc
Q 002446 541 SLCASG-PPVT-----LSVVSRIRNGNNGWRGTVSGAAAAATG-----RVSSLSGAIASSFHNCKGNSETYAAGSSLKIK 609 (921)
Q Consensus 541 ~l~~~~-~pv~-----ls~v~rI~~~~~~w~~~v~~~~~~~~~-----~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~ 609 (921)
.-.+|| -|.- -..|-.+|+.|.- .. +-..|| -.=...|++-|+ |.-.. +.-..+..
T Consensus 222 ~~~v~pdrP~lavcy~nGr~QiMR~eND~--~P----vv~dtgm~~vgakWnh~G~vLAv---cG~~~----da~~~~d~ 288 (1189)
T KOG2041|consen 222 YQPVPPDRPRLAVCYANGRMQIMRSENDP--EP----VVVDTGMKIVGAKWNHNGAVLAV---CGNDS----DADEPTDS 288 (1189)
T ss_pred cccCCCCCCEEEEEEcCceehhhhhcCCC--CC----eEEecccEeecceecCCCcEEEE---ccCcc----cccCcccc
Confidence 222222 1330 1122334444421 11 112233 233456777666 52221 11113344
Q ss_pred ccEEEEccCCcEEEEeeecccCCCcc--cCCCCCCCCCCCCCCCCceEEEeeeeeeecc
Q 002446 610 NHLLVFSPSGCMIQYALRISTGLDVT--MGVPGLGSAYDSVPEDDPRLVVEAIQKWNIC 666 (921)
Q Consensus 610 ~~L~v~sp~G~liqy~L~p~~~~~~~--~~~~~~~~~~~~~~~~~~~~~vep~~~Wdvc 666 (921)
...-.|+|-||++.|.=-|-.....- ++ .+..++. -++..-.--.+.|--+|--|
T Consensus 289 n~v~Fysp~G~i~gtlkvpg~~It~lsWEg-~gLriA~-AvdsfiyfanIRP~ykWgy~ 345 (1189)
T KOG2041|consen 289 NKVHFYSPYGHIVGTLKVPGSCITGLSWEG-TGLRIAI-AVDSFIYFANIRPEYKWGYI 345 (1189)
T ss_pred ceEEEeccchhheEEEecCCceeeeeEEcC-CceEEEE-EecceEEEEeecccceEEEe
Confidence 56778999999999976654321110 00 0111110 01222233467888899877
No 338
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=86.69 E-value=70 Score=41.93 Aligned_cols=98 Identities=14% Similarity=0.211 Sum_probs=59.6
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCC--EEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGH--NINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt--~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
..|+|||-. +.+-..=..-..-=.+|+|=|+|.++|+--.++. .|.+|.-.--.++ -+.+++-.
T Consensus 222 RkirV~drE-g~Lns~se~~~~l~~~LsWkPsgs~iA~iq~~~sd~~IvffErNGL~hg-------------~f~l~~p~ 287 (1265)
T KOG1920|consen 222 RKIRVYDRE-GALNSTSEPVEGLQHSLSWKPSGSLIAAIQCKTSDSDIVFFERNGLRHG-------------EFVLPFPL 287 (1265)
T ss_pred eeEEEeccc-chhhcccCcccccccceeecCCCCeEeeeeecCCCCcEEEEecCCcccc-------------ccccCCcc
Confidence 689999977 3321111122223346999999999999643321 3777753321111 13333333
Q ss_pred ccccEEEEEEccCCCEEEE---EeCCCcEEEEecCCC
Q 002446 468 TNAVIQDISFSDDSNWIMI---SSSRGTSHLFAINPL 501 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAs---gS~DgTVhVWdi~~~ 501 (921)
....|..++|+.++..||+ .....-|.+|-+..|
T Consensus 288 de~~ve~L~Wns~sdiLAv~~~~~e~~~v~lwt~~Ny 324 (1265)
T KOG1920|consen 288 DEKEVEELAWNSNSDILAVVTSNLENSLVQLWTTGNY 324 (1265)
T ss_pred cccchheeeecCCCCceeeeecccccceEEEEEecCe
Confidence 3333899999999999999 444445999987654
No 339
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=86.66 E-value=1.6 Score=53.31 Aligned_cols=108 Identities=11% Similarity=0.206 Sum_probs=74.0
Q ss_pred EEEEECCC---CceEEEeccCCCCeEEEEECCCC-CEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 392 VIVRDIVS---KNVIAQFRAHKSPISALCFDPSG-ILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 392 V~IwDl~s---~~~l~~~~aH~~pIsaLaFSPdG-tlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
-.||.+.. ..+...+-+|+.+|+.+-|+|.- ..|||++.|- .++.||+... ...+|...-=+
T Consensus 93 aiiwnlA~ss~~aIef~lhghsraitd~n~~~q~pdVlatcsvdt-~vh~wd~rSp-------------~~p~ys~~~w~ 158 (1081)
T KOG0309|consen 93 AIIWNLAKSSSNAIEFVLHGHSRAITDINFNPQHPDVLATCSVDT-YVHAWDMRSP-------------HRPFYSTSSWR 158 (1081)
T ss_pred hhhhhhhcCCccceEEEEecCccceeccccCCCCCcceeeccccc-cceeeeccCC-------------Ccceeeeeccc
Confidence 45676653 33445566999999999999964 5899999995 5999999864 12334332111
Q ss_pred ccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc-eeecCCCCCcc
Q 002446 468 TNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS-VNFQPTDANFT 515 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~-~~l~~H~~~~~ 515 (921)
+. -..++|+--.-.+.+.+..+-|+|||+..++-+ ..+++|...+.
T Consensus 159 s~--asqVkwnyk~p~vlasshg~~i~vwd~r~gs~pl~s~K~~vs~vn 205 (1081)
T KOG0309|consen 159 SA--ASQVKWNYKDPNVLASSHGNDIFVWDLRKGSTPLCSLKGHVSSVN 205 (1081)
T ss_pred cc--CceeeecccCcchhhhccCCceEEEeccCCCcceEEecccceeee
Confidence 22 346889865555556677788999999876655 46788766544
No 340
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=86.42 E-value=1.4 Score=55.81 Aligned_cols=56 Identities=20% Similarity=0.477 Sum_probs=40.2
Q ss_pred CCCCEEEEEECCCC-ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 387 DNVGMVIVRDIVSK-NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 387 ~~~G~V~IwDl~s~-~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
...|.|...|.... .+...=..-.+||++++|+.||++|+.|=.+|. |.+||+..+
T Consensus 106 Ts~ghvl~~d~~~nL~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~-V~v~D~~~~ 162 (1206)
T KOG2079|consen 106 TSHGHVLLSDMTGNLGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGH-VTVWDMHRA 162 (1206)
T ss_pred cCchhhhhhhhhcccchhhcCCccCCcceeeEecCCCceeccccCCCc-EEEEEccCC
Confidence 34466666666543 111111223579999999999999999999997 999999875
No 341
>PRK13616 lipoprotein LpqB; Provisional
Probab=86.25 E-value=4.6 Score=49.51 Aligned_cols=92 Identities=9% Similarity=0.080 Sum_probs=53.7
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE--EEecc-
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY--RLQRG- 466 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~--~l~RG- 466 (921)
..+.+++... .....+.+. ..++-.|+|||+.|++.+.....+++.+-... ..++ .+.-|
T Consensus 379 s~Lwv~~~gg-~~~~lt~g~--~~t~PsWspDG~~lw~v~dg~~~~~v~~~~~~--------------gql~~~~vd~ge 441 (591)
T PRK13616 379 SSLWVGPLGG-VAVQVLEGH--SLTRPSWSLDADAVWVVVDGNTVVRVIRDPAT--------------GQLARTPVDASA 441 (591)
T ss_pred eEEEEEeCCC-cceeeecCC--CCCCceECCCCCceEEEecCcceEEEeccCCC--------------ceEEEEeccCch
Confidence 4566667533 222223333 37788999999999998765344444433211 0112 11111
Q ss_pred ---cccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 467 ---LTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 467 ---~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
.-...|.++.|||||++||... +|.|+|=-+.
T Consensus 442 ~~~~~~g~Issl~wSpDG~RiA~i~-~g~v~Va~Vv 476 (591)
T PRK13616 442 VASRVPGPISELQLSRDGVRAAMII-GGKVYLAVVE 476 (591)
T ss_pred hhhccCCCcCeEEECCCCCEEEEEE-CCEEEEEEEE
Confidence 0112499999999999999877 5667664443
No 342
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=86.11 E-value=2.3 Score=50.02 Aligned_cols=96 Identities=26% Similarity=0.396 Sum_probs=59.6
Q ss_pred CEEEEEECCCCc--eEEEeccCCCCeEEEEECCCCCEEEEEec-CCC-EEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 390 GMVIVRDIVSKN--VIAQFRAHKSPISALCFDPSGILLVTASV-QGH-NINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 390 G~V~IwDl~s~~--~l~~~~aH~~pIsaLaFSPdGtlLATaS~-DGt-~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
..+.++|+.+++ .+..+.+|.. .-+|+|||++||-++. ||. .|-++|+... .+.+|.+
T Consensus 218 ~~i~~~~l~~g~~~~i~~~~g~~~---~P~fspDG~~l~f~~~rdg~~~iy~~dl~~~---------------~~~~Lt~ 279 (425)
T COG0823 218 PRIYYLDLNTGKRPVILNFNGNNG---APAFSPDGSKLAFSSSRDGSPDIYLMDLDGK---------------NLPRLTN 279 (425)
T ss_pred ceEEEEeccCCccceeeccCCccC---CccCCCCCCEEEEEECCCCCccEEEEcCCCC---------------cceeccc
Confidence 468899998875 3445556553 3689999998877654 443 2444455443 1222333
Q ss_pred ccccccEEEEEEccCCCEEEEEeCC-CcEEEEecCCCCCce
Q 002446 466 GLTNAVIQDISFSDDSNWIMISSSR-GTSHLFAINPLGGSV 505 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS~D-gTVhVWdi~~~g~~~ 505 (921)
+... -..=+|||||++|+-.|++ |.-.||-+...++..
T Consensus 280 ~~gi--~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~ 318 (425)
T COG0823 280 GFGI--NTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQV 318 (425)
T ss_pred CCcc--ccCccCCCCCCEEEEEeCCCCCcceEEECCCCCce
Confidence 3221 2256799999999876664 556777777665544
No 343
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=85.78 E-value=9.1 Score=48.36 Aligned_cols=58 Identities=12% Similarity=0.189 Sum_probs=45.4
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
+++-+...|.||+||-...+....|.+-..||..|..+.||++|+..+. +.+-|+++.
T Consensus 590 ~iavgs~~G~IRLyd~~g~~AKT~lp~lG~pI~~iDvt~DGkwilaTc~--tyLlLi~t~ 647 (794)
T PF08553_consen 590 YIAVGSNKGDIRLYDRLGKRAKTALPGLGDPIIGIDVTADGKWILATCK--TYLLLIDTL 647 (794)
T ss_pred eEEEEeCCCcEEeecccchhhhhcCCCCCCCeeEEEecCCCcEEEEeec--ceEEEEEEe
Confidence 4455677899999997666666778888899999999999998665443 347788864
No 344
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=85.39 E-value=22 Score=38.35 Aligned_cols=53 Identities=11% Similarity=0.134 Sum_probs=44.9
Q ss_pred CCcEEEEEECCCC-----cEEEEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCcE
Q 002446 204 VPTVVHFYSLRSQ-----SYVHMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLEI 256 (921)
Q Consensus 204 ~~~tVrIWDL~Tg-----~~V~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~~ 256 (921)
..++|.+|..... +.++++..+..+.+|.+.++.|+++..+...+.|+.++..
T Consensus 112 ~kk~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~~~~~i~v~~~~~f~~idl~~~~~ 169 (275)
T PF00780_consen 112 VKKKILIYEWNDPRNSFSKLLKEISLPDPPSSIAFLGNKICVGTSKGFYLIDLNTGSP 169 (275)
T ss_pred ECCEEEEEEEECCcccccceeEEEEcCCCcEEEEEeCCEEEEEeCCceEEEecCCCCc
Confidence 3468888877653 5778889999999999999999999899999999998764
No 345
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=84.93 E-value=29 Score=39.23 Aligned_cols=121 Identities=21% Similarity=0.256 Sum_probs=67.5
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce-eEEEEEecccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY-VHLYRLQRGLT 468 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~-~~l~~l~RG~t 468 (921)
+.|.-||..+++. ..|......-..+.++..|.+++ + .+| +.+++..++ .. ..+.....+..
T Consensus 47 ~~i~r~~~~~g~~-~~~~~p~~~~~~~~~d~~g~Lv~-~-~~g--~~~~~~~~~------------~~~t~~~~~~~~~~ 109 (307)
T COG3386 47 GRIHRLDPETGKK-RVFPSPGGFSSGALIDAGGRLIA-C-EHG--VRLLDPDTG------------GKITLLAEPEDGLP 109 (307)
T ss_pred CeEEEecCCcCce-EEEECCCCcccceeecCCCeEEE-E-ccc--cEEEeccCC------------ceeEEeccccCCCC
Confidence 5677777776543 33433333334456666665444 3 333 577887554 12 33444445555
Q ss_pred cccEEEEEEccCCCEEEEEeC---------CCcEEEEecCCCCCceee-cCCCCCcccccCCcCCccccCCCCCCCCC-C
Q 002446 469 NAVIQDISFSDDSNWIMISSS---------RGTSHLFAINPLGGSVNF-QPTDANFTTKHGAMAKSGVRWPPNLGLQM-P 537 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~---------DgTVhVWdi~~~g~~~~l-~~H~~~~~~~~~~~~~~~~r~~~~s~l~~-~ 537 (921)
....+++...|||.+-+.... ..+=.||.+.+.+....+ ..| .....++.| +
T Consensus 110 ~~r~ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p~g~~~~l~~~~-----------------~~~~NGla~Sp 172 (307)
T COG3386 110 LNRPNDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDPDGGVVRLLDDD-----------------LTIPNGLAFSP 172 (307)
T ss_pred cCCCCceeEcCCCCEEEeCCCccccCccccCCcceEEEEcCCCCEEEeecCc-----------------EEecCceEECC
Confidence 556789999999998776544 223356666654333333 111 112345666 8
Q ss_pred CCccccc
Q 002446 538 NQQSLCA 544 (921)
Q Consensus 538 ~~~~l~~ 544 (921)
|+++|+.
T Consensus 173 Dg~tly~ 179 (307)
T COG3386 173 DGKTLYV 179 (307)
T ss_pred CCCEEEE
Confidence 8888875
No 346
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=84.68 E-value=97 Score=37.07 Aligned_cols=58 Identities=10% Similarity=0.105 Sum_probs=40.1
Q ss_pred cEEEEEECCCCcEEEEEeCCCCE------E-EEEEcCCEEEEE----------eCCEEEEEECCCCcEEEEEecC
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPI------Y-SVRCSSRVVAIC----------QAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V------~-sV~~S~riLAVa----------~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
+.|.-+|.+||+.+-..+....+ . +..+...++.+. .++.|+++|+.|++.+++....
T Consensus 120 g~v~AlD~~TG~~~W~~~~~~~~~~~~~i~ssP~v~~~~v~vg~~~~~~~~~~~~g~v~alD~~TG~~~W~~~~~ 194 (488)
T cd00216 120 GRLVALDAETGKQVWKFGNNDQVPPGYTMTGAPTIVKKLVIIGSSGAEFFACGVRGALRAYDVETGKLLWRFYTT 194 (488)
T ss_pred CeEEEEECCCCCEeeeecCCCCcCcceEecCCCEEECCEEEEeccccccccCCCCcEEEEEECCCCceeeEeecc
Confidence 56888899999999887765431 1 112223444443 2468999999999999887653
No 347
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=84.57 E-value=6.2 Score=48.92 Aligned_cols=106 Identities=18% Similarity=0.324 Sum_probs=72.6
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCC-----CCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCc
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPS-----GILLVTASVQGHNINIFKIIPGILGTSSACDAGTS 456 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPd-----GtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~ 456 (921)
.++++..||+|.|-.+.+.+...++.=+ -||.+++|+|| .+.+++++..| +-++.-.- .+.
T Consensus 85 y~asCS~DGkv~I~sl~~~~~~~~~df~-rpiksial~Pd~~~~~sk~fv~GG~ag--lvL~er~w--lgn--------- 150 (846)
T KOG2066|consen 85 YVASCSDDGKVVIGSLFTDDEITQYDFK-RPIKSIALHPDFSRQQSKQFVSGGMAG--LVLSERNW--LGN--------- 150 (846)
T ss_pred eEEEecCCCcEEEeeccCCccceeEecC-CcceeEEeccchhhhhhhheeecCcce--EEEehhhh--hcC---------
Confidence 3456788999999998888776655543 48999999998 67889998887 44553211 010
Q ss_pred eeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 457 YVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 457 ~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
...+ .++.|. ..|.+|+|- |.++|=++++| |+|||+........+
T Consensus 151 k~~v-~l~~~e--G~I~~i~W~--g~lIAWand~G-v~vyd~~~~~~l~~i 195 (846)
T KOG2066|consen 151 KDSV-VLSEGE--GPIHSIKWR--GNLIAWANDDG-VKVYDTPTRQRLTNI 195 (846)
T ss_pred ccce-eeecCc--cceEEEEec--CcEEEEecCCC-cEEEeccccceeecc
Confidence 0111 232222 349999995 78999998887 889999876555444
No 348
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=83.59 E-value=8.7 Score=45.00 Aligned_cols=97 Identities=16% Similarity=0.293 Sum_probs=59.9
Q ss_pred EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC----CCCC---ccCCCCc--eeEEEEEecc-------
Q 002446 403 IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL----GTSS---ACDAGTS--YVHLYRLQRG------- 466 (921)
Q Consensus 403 l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~----~~~s---~~~~~~~--~~~l~~l~RG------- 466 (921)
+-.|.--+...+++.|+|+|..+++-+.|- .||+|+..++-- .... ...+... ..++ +|.|.
T Consensus 194 Ly~f~K~Kt~pts~Efsp~g~qistl~~Dr-kVR~F~~KtGklvqeiDE~~t~~~~q~ks~y~l~~V-elgRRmaverel 271 (558)
T KOG0882|consen 194 LYGFPKAKTEPTSFEFSPDGAQISTLNPDR-KVRGFVFKTGKLVQEIDEVLTDAQYQPKSPYGLMHV-ELGRRMAVEREL 271 (558)
T ss_pred hhcccccccCccceEEccccCcccccCccc-EEEEEEeccchhhhhhhccchhhhhcccccccccee-ehhhhhhHHhhH
Confidence 333444456778999999999999999885 599999988610 0000 0000000 0010 11111
Q ss_pred --cccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCC
Q 002446 467 --LTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLG 502 (921)
Q Consensus 467 --~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g 502 (921)
+...+-..++|...|++|.-++.=| |+|+.+.+..
T Consensus 272 ek~~~~~~~~~~fdes~~flly~t~~g-ikvin~~tn~ 308 (558)
T KOG0882|consen 272 EKHGSTVGTNAVFDESGNFLLYGTILG-IKVINLDTNT 308 (558)
T ss_pred hhhcCcccceeEEcCCCCEEEeeccee-EEEEEeecCe
Confidence 1222346788999999999988766 8888887753
No 349
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=83.41 E-value=1e+02 Score=37.51 Aligned_cols=53 Identities=15% Similarity=0.331 Sum_probs=37.4
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCC
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g 443 (921)
-|.+.=+|+.+++.+-.++......... +.-.|.++..++.+|. ++.||..++
T Consensus 440 ~g~l~AiD~~tGk~~W~~~~~~p~~~~~-l~t~g~lvf~g~~~G~-l~a~D~~TG 492 (527)
T TIGR03075 440 MGSLIAWDPITGKIVWEHKEDFPLWGGV-LATAGDLVFYGTLEGY-FKAFDAKTG 492 (527)
T ss_pred ceeEEEEeCCCCceeeEecCCCCCCCcc-eEECCcEEEEECCCCe-EEEEECCCC
Confidence 4788899999999988776433222221 1225557777888986 999999997
No 350
>PF10168 Nup88: Nuclear pore component; InterPro: IPR019321 Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells [].
Probab=82.99 E-value=20 Score=45.05 Aligned_cols=91 Identities=13% Similarity=0.252 Sum_probs=57.9
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCcc---CCCCceeEEE---EEecccccccEEEEEEccC---C
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSAC---DAGTSYVHLY---RLQRGLTNAVIQDISFSDD---S 481 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~---~~~~~~~~l~---~l~RG~t~a~I~sIaFSPD---g 481 (921)
..|..|.+||+|++||-++..| |-|-.+... .|..+.. ...-.|+... .+.+......|..+.|.|. +
T Consensus 85 f~v~~i~~n~~g~~lal~G~~~--v~V~~LP~r-~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s~~~ 161 (717)
T PF10168_consen 85 FEVHQISLNPTGSLLALVGPRG--VVVLELPRR-WGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWSESD 161 (717)
T ss_pred eeEEEEEECCCCCEEEEEcCCc--EEEEEeccc-cCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCCCCC
Confidence 4688899999999999999987 556666431 1111100 0001111110 1122223346999999987 5
Q ss_pred CEEEEEeCCCcEEEEecCCCCCc
Q 002446 482 NWIMISSSRGTSHLFAINPLGGS 504 (921)
Q Consensus 482 ~~LAsgS~DgTVhVWdi~~~g~~ 504 (921)
..|++=++|+++++||+.....+
T Consensus 162 ~~l~vLtsdn~lR~y~~~~~~~p 184 (717)
T PF10168_consen 162 SHLVVLTSDNTLRLYDISDPQHP 184 (717)
T ss_pred CeEEEEecCCEEEEEecCCCCCC
Confidence 89999999999999999865444
No 351
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=82.90 E-value=2.7 Score=33.87 Aligned_cols=32 Identities=25% Similarity=0.330 Sum_probs=26.2
Q ss_pred CCeEEEEECCCC---CEEEEEecCCCEEEEEeCCCC
Q 002446 411 SPISALCFDPSG---ILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 411 ~pIsaLaFSPdG---tlLATaS~DGt~IrIWdi~~g 443 (921)
++|.+++|||+. .+||.+-..|. |+|+|+..+
T Consensus 1 GAvR~~kFsP~~~~~DLL~~~E~~g~-vhi~D~R~~ 35 (43)
T PF10313_consen 1 GAVRCCKFSPEPGGNDLLAWAEHQGR-VHIVDTRSN 35 (43)
T ss_pred CCeEEEEeCCCCCcccEEEEEccCCe-EEEEEcccC
Confidence 478999999854 59998888886 999999853
No 352
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=82.89 E-value=36 Score=39.05 Aligned_cols=51 Identities=22% Similarity=0.425 Sum_probs=40.3
Q ss_pred EEEEEECCCCceEEEeccCCCCeEEEEECCCCC-EEEEEec-CCCEEEEEeCCCC
Q 002446 391 MVIVRDIVSKNVIAQFRAHKSPISALCFDPSGI-LLVTASV-QGHNINIFKIIPG 443 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGt-lLATaS~-DGt~IrIWdi~~g 443 (921)
.|-++|+.+++.+..+.. ..+|.+|+.+.|.+ +|.+.+. +|. +.|||..++
T Consensus 270 eVWv~D~~t~krv~Ri~l-~~~~~Si~Vsqd~~P~L~~~~~~~~~-l~v~D~~tG 322 (342)
T PF06433_consen 270 EVWVYDLKTHKRVARIPL-EHPIDSIAVSQDDKPLLYALSAGDGT-LDVYDAATG 322 (342)
T ss_dssp EEEEEETTTTEEEEEEEE-EEEESEEEEESSSS-EEEEEETTTTE-EEEEETTT-
T ss_pred EEEEEECCCCeEEEEEeC-CCccceEEEccCCCcEEEEEcCCCCe-EEEEeCcCC
Confidence 688899999999999883 13688999999988 6655554 565 899999987
No 353
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=82.77 E-value=18 Score=41.89 Aligned_cols=95 Identities=15% Similarity=0.225 Sum_probs=67.1
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC--CCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ--GHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D--Gt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
....|.+.|..+.+.+..+.--. .-..++|+|+|+.+..+... ...+.+.|..+. ..+.+...
T Consensus 94 ~~~~v~vid~~~~~~~~~~~vG~-~P~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~--------------~~~~~~~v 158 (381)
T COG3391 94 DSNTVSVIDTATNTVLGSIPVGL-GPVGLAVDPDGKYVYVANAGNGNNTVSVIDAATN--------------KVTATIPV 158 (381)
T ss_pred CCCeEEEEcCcccceeeEeeecc-CCceEEECCCCCEEEEEecccCCceEEEEeCCCC--------------eEEEEEec
Confidence 35789999988887776665222 44569999999888777762 244777777764 23334555
Q ss_pred ccccccEEEEEEccCCCEEEEEe-CCCcEEEEecCC
Q 002446 466 GLTNAVIQDISFSDDSNWIMISS-SRGTSHLFAINP 500 (921)
Q Consensus 466 G~t~a~I~sIaFSPDg~~LAsgS-~DgTVhVWdi~~ 500 (921)
|... ..++++|+|+.+.+.. .++++.+++.+.
T Consensus 159 G~~P---~~~a~~p~g~~vyv~~~~~~~v~vi~~~~ 191 (381)
T COG3391 159 GNTP---TGVAVDPDGNKVYVTNSDDNTVSVIDTSG 191 (381)
T ss_pred CCCc---ceEEECCCCCeEEEEecCCCeEEEEeCCC
Confidence 6433 7899999999766554 789999999544
No 354
>PF00930 DPPIV_N: Dipeptidyl peptidase IV (DPP IV) N-terminal region; InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis. Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide It is a type II membrane protein that forms a homodimer. CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=82.17 E-value=70 Score=36.38 Aligned_cols=50 Identities=12% Similarity=0.111 Sum_probs=39.1
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEeCCEEEEEECCCCc
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQAAQVHCFDAATLE 255 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~d~~I~IwDl~T~~ 255 (921)
+.+-+||+.+++..........+....+| ++.||...++.|+++++.+.+
T Consensus 23 ~~y~i~d~~~~~~~~l~~~~~~~~~~~~sP~g~~~~~v~~~nly~~~~~~~~ 74 (353)
T PF00930_consen 23 GDYYIYDIETGEITPLTPPPPKLQDAKWSPDGKYIAFVRDNNLYLRDLATGQ 74 (353)
T ss_dssp EEEEEEETTTTEEEESS-EETTBSEEEE-SSSTEEEEEETTEEEEESSTTSE
T ss_pred eeEEEEecCCCceEECcCCccccccceeecCCCeeEEEecCceEEEECCCCC
Confidence 67899999998765543335677788887 689999999999999998884
No 355
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=82.09 E-value=7.8 Score=44.01 Aligned_cols=113 Identities=12% Similarity=0.198 Sum_probs=72.6
Q ss_pred CCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCC--CC-------CCc---------cCCCC-----
Q 002446 399 SKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGIL--GT-------SSA---------CDAGT----- 455 (921)
Q Consensus 399 s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~--~~-------~s~---------~~~~~----- 455 (921)
....+....+|..+|..+-|+-.-+++++++.|.. -.|-...... |. +.. ++-..
T Consensus 103 km~~~r~~~~h~~~v~~~if~~~~e~V~s~~~dk~--~~~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~l 180 (404)
T KOG1409|consen 103 KMTFLKDYLAHQARVSAIVFSLTHEWVLSTGKDKQ--FAWHCTESGNRLGGYNFETPASALQFDALYAFVGDHSGQITML 180 (404)
T ss_pred hcchhhhhhhhhcceeeEEecCCceeEEEeccccc--eEEEeeccCCcccceEeeccCCCCceeeEEEEecccccceEEE
Confidence 33455566688888888888888888888888753 2443322100 00 000 00000
Q ss_pred -----ceeEEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCc-eeecCCCCCcc
Q 002446 456 -----SYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGS-VNFQPTDANFT 515 (921)
Q Consensus 456 -----~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~-~~l~~H~~~~~ 515 (921)
.+..++++ +|++. .|++++|.|-.+.|.++..|..+.+|||--..+. ..+++|.+.+.
T Consensus 181 r~~~~~~~~i~~~-~~h~~-~~~~l~Wd~~~~~LfSg~~d~~vi~wdigg~~g~~~el~gh~~kV~ 244 (404)
T KOG1409|consen 181 KLEQNGCQLITTF-NGHTG-EVTCLKWDPGQRLLFSGASDHSVIMWDIGGRKGTAYELQGHNDKVQ 244 (404)
T ss_pred EEeecCCceEEEE-cCccc-ceEEEEEcCCCcEEEeccccCceEEEeccCCcceeeeeccchhhhh
Confidence 11223343 56554 4999999999999999999999999999765554 46788876655
No 356
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=82.00 E-value=1.8 Score=54.96 Aligned_cols=74 Identities=11% Similarity=0.211 Sum_probs=54.6
Q ss_pred CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc-ccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 421 SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL-TNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 421 dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~-t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
-+..+|.++..|+ +-.+|.... +.-+++|. ....|.++||+.||++++.|-.+|-|.+||++
T Consensus 98 ~~~~ivi~Ts~gh-vl~~d~~~n----------------L~~~~~ne~v~~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~ 160 (1206)
T KOG2079|consen 98 VVVPIVIGTSHGH-VLLSDMTGN----------------LGPLHQNERVQGPVTSVAFNQDGSLLLAGLGDGHVTVWDMH 160 (1206)
T ss_pred eeeeEEEEcCchh-hhhhhhhcc----------------cchhhcCCccCCcceeeEecCCCceeccccCCCcEEEEEcc
Confidence 5667888888887 677776542 11122221 23459999999999999999999999999999
Q ss_pred CCCCceeecCCC
Q 002446 500 PLGGSVNFQPTD 511 (921)
Q Consensus 500 ~~g~~~~l~~H~ 511 (921)
.......+.-|+
T Consensus 161 ~~k~l~~i~e~~ 172 (1206)
T KOG2079|consen 161 RAKILKVITEHG 172 (1206)
T ss_pred CCcceeeeeecC
Confidence 877766665543
No 357
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=81.19 E-value=13 Score=43.93 Aligned_cols=109 Identities=14% Similarity=0.134 Sum_probs=55.3
Q ss_pred CCCCEEEEEECCCCceEEEecc-CCC-CeEEEEECCC--CCE-EEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRA-HKS-PISALCFDPS--GIL-LVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~a-H~~-pIsaLaFSPd--Gtl-LATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
..-..+.+||+.+.+.++++.- -.+ -...|.|-.+ -.+ ++.|.-.+++.++|....+ . | ..+.+.
T Consensus 219 ~yG~~l~vWD~~~r~~~Q~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k~~~g-~-------W--~a~kVi 288 (461)
T PF05694_consen 219 KYGHSLHVWDWSTRKLLQTIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYKDDDG-E-------W--AAEKVI 288 (461)
T ss_dssp -S--EEEEEETTTTEEEEEEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE-ETT-E-------E--EEEEEE
T ss_pred cccCeEEEEECCCCcEeeEEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEEcCCC-C-------e--eeeEEE
Confidence 3456899999999999998873 222 3456777554 444 4444444444455543332 1 1 112222
Q ss_pred EEec---------------ccccccEEEEEEccCCCEEEEEe-CCCcEEEEecCCCCCce
Q 002446 462 RLQR---------------GLTNAVIQDISFSDDSNWIMISS-SRGTSHLFAINPLGGSV 505 (921)
Q Consensus 462 ~l~R---------------G~t~a~I~sIaFSPDg~~LAsgS-~DgTVhVWdi~~~g~~~ 505 (921)
++.- +...+-|++|..|.|.+||-.+. .+|.|+.|||+....+.
T Consensus 289 ~ip~~~v~~~~lp~ml~~~~~~P~LitDI~iSlDDrfLYvs~W~~GdvrqYDISDP~~Pk 348 (461)
T PF05694_consen 289 DIPAKKVEGWILPEMLKPFGAVPPLITDILISLDDRFLYVSNWLHGDVRQYDISDPFNPK 348 (461)
T ss_dssp EE--EE--SS---GGGGGG-EE------EEE-TTS-EEEEEETTTTEEEEEE-SSTTS-E
T ss_pred ECCCcccCcccccccccccccCCCceEeEEEccCCCEEEEEcccCCcEEEEecCCCCCCc
Confidence 2210 11123489999999999997665 69999999999875543
No 358
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=81.01 E-value=1.4e+02 Score=36.29 Aligned_cols=59 Identities=17% Similarity=0.164 Sum_probs=37.1
Q ss_pred cEEEEEECCCCcEEEEEeCCCC--EEEEE-----EcCCEEEEEe------CCEEEEEECCCCcEEEEEecCC
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSP--IYSVR-----CSSRVVAICQ------AAQVHCFDAATLEIEYAILTNP 264 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~--V~sV~-----~S~riLAVa~------d~~I~IwDl~T~~~l~tL~t~p 264 (921)
+.|.-.|.+||+.+-....... -+.+. ...++++... ++.|+.||+.|++.+++..+-+
T Consensus 130 g~l~ALDa~TGk~~W~~~~~~~~~~~~~tssP~v~~g~Vivg~~~~~~~~~G~v~AlD~~TG~~lW~~~~~p 201 (527)
T TIGR03075 130 ARLVALDAKTGKVVWSKKNGDYKAGYTITAAPLVVKGKVITGISGGEFGVRGYVTAYDAKTGKLVWRRYTVP 201 (527)
T ss_pred CEEEEEECCCCCEEeecccccccccccccCCcEEECCEEEEeecccccCCCcEEEEEECCCCceeEeccCcC
Confidence 4567778999988876654210 01111 1233333332 5799999999999998877654
No 359
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=80.28 E-value=9.9 Score=43.83 Aligned_cols=76 Identities=18% Similarity=0.300 Sum_probs=48.2
Q ss_pred CeEEEEECCCCCEEEEE-ecCC---CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEE
Q 002446 412 PISALCFDPSGILLVTA-SVQG---HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMIS 487 (921)
Q Consensus 412 pIsaLaFSPdGtlLATa-S~DG---t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsg 487 (921)
.+...++||||++||-+ +..| ..++|+|+.++ ..+-. +.....-..++|++|++.|.-.
T Consensus 125 ~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg--------------~~l~d---~i~~~~~~~~~W~~d~~~~~y~ 187 (414)
T PF02897_consen 125 SLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETG--------------KFLPD---GIENPKFSSVSWSDDGKGFFYT 187 (414)
T ss_dssp EEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTT--------------EEEEE---EEEEEESEEEEECTTSSEEEEE
T ss_pred EeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCC--------------cCcCC---cccccccceEEEeCCCCEEEEE
Confidence 44568999999998866 4444 35999999986 22221 1111222349999999987766
Q ss_pred eCCCc-----------EEEEecCCCCCc
Q 002446 488 SSRGT-----------SHLFAINPLGGS 504 (921)
Q Consensus 488 S~DgT-----------VhVWdi~~~g~~ 504 (921)
..+.. |+.|++.+....
T Consensus 188 ~~~~~~~~~~~~~~~~v~~~~~gt~~~~ 215 (414)
T PF02897_consen 188 RFDEDQRTSDSGYPRQVYRHKLGTPQSE 215 (414)
T ss_dssp ECSTTTSS-CCGCCEEEEEEETTS-GGG
T ss_pred EeCcccccccCCCCcEEEEEECCCChHh
Confidence 65442 667777655443
No 360
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=79.56 E-value=3.2 Score=46.39 Aligned_cols=86 Identities=23% Similarity=0.369 Sum_probs=53.4
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCcc----CC-CCceeEEEEEecccccccEEEEEEccCCC--E
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSAC----DA-GTSYVHLYRLQRGLTNAVIQDISFSDDSN--W 483 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~----~~-~~~~~~l~~l~RG~t~a~I~sIaFSPDg~--~ 483 (921)
.-|+++-|+..|.+||||+..|+ +-+|.-... .++...+ .. ......+..+. -..+|..|.|-.++. .
T Consensus 27 d~ItaVefd~tg~YlatGDkgGR-Vvlfer~~s-~~ceykf~teFQshe~EFDYLkSle---ieEKin~I~w~~~t~r~h 101 (460)
T COG5170 27 DKITAVEFDETGLYLATGDKGGR-VVLFEREKS-YGCEYKFFTEFQSHELEFDYLKSLE---IEEKINAIEWFDDTGRNH 101 (460)
T ss_pred ceeeEEEeccccceEeecCCCce-EEEeecccc-cccchhhhhhhcccccchhhhhhcc---HHHHhhheeeecCCCcce
Confidence 46899999999999999998887 778865432 1111100 00 00000011111 112488899976654 4
Q ss_pred EEEEeCCCcEEEEecCCC
Q 002446 484 IMISSSRGTSHLFAINPL 501 (921)
Q Consensus 484 LAsgS~DgTVhVWdi~~~ 501 (921)
+..++.|.||+||.+...
T Consensus 102 FLlstNdktiKlWKiyek 119 (460)
T COG5170 102 FLLSTNDKTIKLWKIYEK 119 (460)
T ss_pred EEEecCCceeeeeeeecc
Confidence 777888999999999764
No 361
>PRK13616 lipoprotein LpqB; Provisional
Probab=79.28 E-value=11 Score=46.31 Aligned_cols=103 Identities=14% Similarity=0.203 Sum_probs=60.9
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccc
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLT 468 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t 468 (921)
.+.+.+.++..+.... .....|+.++|||||+.||... +|+ |.|=-+.....|. ........+.-+..
T Consensus 429 ~gql~~~~vd~ge~~~---~~~g~Issl~wSpDG~RiA~i~-~g~-v~Va~Vvr~~~G~-------~~l~~~~~l~~~l~ 496 (591)
T PRK13616 429 TGQLARTPVDASAVAS---RVPGPISELQLSRDGVRAAMII-GGK-VYLAVVEQTEDGQ-------YALTNPREVGPGLG 496 (591)
T ss_pred CceEEEEeccCchhhh---ccCCCcCeEEECCCCCEEEEEE-CCE-EEEEEEEeCCCCc-------eeecccEEeecccC
Confidence 4566666776665433 3456799999999999998876 454 5553333210110 01111122322322
Q ss_pred cccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCce
Q 002446 469 NAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 469 ~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~ 505 (921)
. .+.+++|..|++.+ ++..++...||.++-.|...
T Consensus 497 ~-~~~~l~W~~~~~L~-V~~~~~~~~v~~v~vDG~~~ 531 (591)
T PRK13616 497 D-TAVSLDWRTGDSLV-VGRSDPEHPVWYVNLDGSNS 531 (591)
T ss_pred C-ccccceEecCCEEE-EEecCCCCceEEEecCCccc
Confidence 2 25789999999954 66666767788876654443
No 362
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=78.82 E-value=71 Score=38.59 Aligned_cols=58 Identities=7% Similarity=0.098 Sum_probs=43.9
Q ss_pred cccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 382 HFPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 382 ~~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
+++-+..+|.|++||-...+....|++-..+|..|..+.||++|+.... +.+-+-++.
T Consensus 443 ~IvvgS~~GdIRLYdri~~~AKTAlPgLG~~I~hVdvtadGKwil~Tc~--tyLlLi~t~ 500 (644)
T KOG2395|consen 443 YIVVGSLKGDIRLYDRIGRRAKTALPGLGDAIKHVDVTADGKWILATCK--TYLLLIDTL 500 (644)
T ss_pred eEEEeecCCcEEeehhhhhhhhhcccccCCceeeEEeeccCcEEEEecc--cEEEEEEEe
Confidence 4455677899999998666667788899999999999999997664433 235565554
No 363
>PRK02888 nitrous-oxide reductase; Validated
Probab=78.68 E-value=14 Score=45.43 Aligned_cols=106 Identities=10% Similarity=0.003 Sum_probs=69.5
Q ss_pred CCEEEEEECCC-----CceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 389 VGMVIVRDIVS-----KNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 389 ~G~V~IwDl~s-----~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
++.|.|.|..+ .+.+..+.--. ....|++||||++|+.++.-...+.|.|+......-...-++.... ..+.
T Consensus 295 gn~V~VID~~t~~~~~~~v~~yIPVGK-sPHGV~vSPDGkylyVanklS~tVSVIDv~k~k~~~~~~~~~~~~v--vaev 371 (635)
T PRK02888 295 GSKVPVVDGRKAANAGSALTRYVPVPK-NPHGVNTSPDGKYFIANGKLSPTVTVIDVRKLDDLFDGKIKPRDAV--VAEP 371 (635)
T ss_pred CCEEEEEECCccccCCcceEEEEECCC-CccceEECCCCCEEEEeCCCCCcEEEEEChhhhhhhhccCCccceE--EEee
Confidence 46799999998 45666665332 3356899999999999887555699999987410000000000111 1222
Q ss_pred ecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 464 QRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 464 ~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.-|.. -.-.+|.++|+-..+--.|..|-.|++..
T Consensus 372 evGlG---PLHTaFDg~G~aytslf~dsqv~kwn~~~ 405 (635)
T PRK02888 372 ELGLG---PLHTAFDGRGNAYTTLFLDSQIVKWNIEA 405 (635)
T ss_pred ccCCC---cceEEECCCCCEEEeEeecceeEEEehHH
Confidence 22433 24588999999888888899999999976
No 364
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=78.51 E-value=9.5 Score=48.17 Aligned_cols=91 Identities=19% Similarity=0.297 Sum_probs=60.2
Q ss_pred CEEEEEECCCC--ceEE-Eec--cCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEe
Q 002446 390 GMVIVRDIVSK--NVIA-QFR--AHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQ 464 (921)
Q Consensus 390 G~V~IwDl~s~--~~l~-~~~--aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~ 464 (921)
..+..||.+-. +++. ..+ ......+|++-+-+|. ||.||.+|. ||+||-. + ..-.++-
T Consensus 552 n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs~~aTt~~G~-iavgs~~G~-IRLyd~~-g--------------~~AKT~l 614 (794)
T PF08553_consen 552 NSLFRIDPRLSGNKLVDSQSKQYSSKNNFSCFATTEDGY-IAVGSNKGD-IRLYDRL-G--------------KRAKTAL 614 (794)
T ss_pred CceEEeccCCCCCceeeccccccccCCCceEEEecCCce-EEEEeCCCc-EEeeccc-c--------------hhhhhcC
Confidence 44666776542 2321 121 3456789999999995 888999997 9999832 2 1112222
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
.|.. ..|..|..+.||+||++.+ +.-+.|++..
T Consensus 615 p~lG-~pI~~iDvt~DGkwilaTc-~tyLlLi~t~ 647 (794)
T PF08553_consen 615 PGLG-DPIIGIDVTADGKWILATC-KTYLLLIDTL 647 (794)
T ss_pred CCCC-CCeeEEEecCCCcEEEEee-cceEEEEEEe
Confidence 3432 3599999999999998776 4567777754
No 365
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=77.81 E-value=6.6 Score=45.37 Aligned_cols=50 Identities=18% Similarity=0.191 Sum_probs=41.7
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEEE-EeCCEEEEEECCCCc
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVAI-CQAAQVHCFDAATLE 255 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLAV-a~d~~I~IwDl~T~~ 255 (921)
++|+|.|++|..++.+......+++.+|. .++|=. -..+.|+|||++..+
T Consensus 216 nkiki~dlet~~~vssy~a~~~~wSC~wDlde~h~IYaGl~nG~VlvyD~R~~~ 269 (463)
T KOG1645|consen 216 NKIKIMDLETSCVVSSYIAYNQIWSCCWDLDERHVIYAGLQNGMVLVYDMRQPE 269 (463)
T ss_pred ceEEEEecccceeeeheeccCCceeeeeccCCcceeEEeccCceEEEEEccCCC
Confidence 78999999999999999989999999994 344433 556899999998654
No 366
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=77.39 E-value=9.9 Score=47.61 Aligned_cols=105 Identities=13% Similarity=0.191 Sum_probs=72.5
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCC-eEEEEECCCCCEEEEEecCCC----EEEEEeCCCCCCCCCCccCCCCcee--
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSP-ISALCFDPSGILLVTASVQGH----NINIFKIIPGILGTSSACDAGTSYV-- 458 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~p-IsaLaFSPdGtlLATaS~DGt----~IrIWdi~~g~~~~~s~~~~~~~~~-- 458 (921)
+..+|.|.+++- +-+.+..|++|... |+.|-...+-.+|++-..|+. .++||++..-....++ .+.
T Consensus 41 gt~~G~V~~Ln~-s~~~~~~fqa~~~siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~lek~~~n~sP------~c~~~ 113 (933)
T KOG2114|consen 41 GTADGRVVILNS-SFQLIRGFQAYEQSIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDLEKVDKNNSP------QCLYE 113 (933)
T ss_pred eeccccEEEecc-cceeeehheecchhhhhHhhcccCceEEEEEeecCCCCceEEEEecccccCCCCCc------ceeee
Confidence 456777766652 33455889999988 666666655579999988887 7999999874111111 111
Q ss_pred -EEEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 459 -HLYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 459 -~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
.+++..-+.....+.+|+.|.|=+.+|+|=.+|+|..+.
T Consensus 114 ~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~ 153 (933)
T KOG2114|consen 114 HRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGLVICYK 153 (933)
T ss_pred eeeeccCCCCCCCcceEEEEEccccEEEEEecCcEEEEEc
Confidence 122222233345588999999999999999999998874
No 367
>PF10313 DUF2415: Uncharacterised protein domain (DUF2415); InterPro: IPR019417 This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif.
Probab=77.39 E-value=6.4 Score=31.80 Aligned_cols=29 Identities=14% Similarity=0.331 Sum_probs=25.6
Q ss_pred EEEEEEccCCC---EEEEEeCCCcEEEEecCC
Q 002446 472 IQDISFSDDSN---WIMISSSRGTSHLFAINP 500 (921)
Q Consensus 472 I~sIaFSPDg~---~LAsgS~DgTVhVWdi~~ 500 (921)
|.++.|||+.. +||.+-..|-|||+|+..
T Consensus 3 vR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~ 34 (43)
T PF10313_consen 3 VRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS 34 (43)
T ss_pred eEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence 88999998554 999999999999999984
No 368
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=76.64 E-value=16 Score=43.08 Aligned_cols=90 Identities=18% Similarity=0.337 Sum_probs=58.4
Q ss_pred EEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE-ccC-
Q 002446 403 IAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF-SDD- 480 (921)
Q Consensus 403 l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF-SPD- 480 (921)
...|....-.+.+|+.+|+|++.|+++.-|+ |-|+|+..+ .+.++..|+..|...-+.- .+.
T Consensus 300 r~~l~D~~R~~~~i~~sP~~~laA~tDslGR-V~LiD~~~~---------------~vvrmWKGYRdAqc~wi~~~~~~~ 363 (415)
T PF14655_consen 300 RFGLPDSKREGESICLSPSGRLAAVTDSLGR-VLLIDVARG---------------IVVRMWKGYRDAQCGWIEVPEEGD 363 (415)
T ss_pred EEeeccCCceEEEEEECCCCCEEEEEcCCCc-EEEEECCCC---------------hhhhhhccCccceEEEEEeecccc
Confidence 3445555556889999999999999988888 899999986 1223334554453221111 111
Q ss_pred ---------------CCEEEE-EeCCCcEEEEecCCCCCceeec
Q 002446 481 ---------------SNWIMI-SSSRGTSHLFAINPLGGSVNFQ 508 (921)
Q Consensus 481 ---------------g~~LAs-gS~DgTVhVWdi~~~g~~~~l~ 508 (921)
..+|++ +-.+|.+-||.+..+.....++
T Consensus 364 ~~~~~~~~~~~~~~~~l~LvIyaprRg~lEvW~~~~g~Rv~a~~ 407 (415)
T PF14655_consen 364 RDRSNSNSPKSSSRFALFLVIYAPRRGILEVWSMRQGPRVAAFN 407 (415)
T ss_pred cccccccccCCCCcceEEEEEEeccCCeEEEEecCCCCEEEEEE
Confidence 234554 6679999999998865554543
No 369
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=75.25 E-value=16 Score=36.50 Aligned_cols=46 Identities=11% Similarity=0.154 Sum_probs=37.1
Q ss_pred CCcEEEEEeCCCCEEEEEEc-------CCEEEEEeCCEEEEEECCCCcEEEEE
Q 002446 215 SQSYVHMLKFRSPIYSVRCS-------SRVVAICQAAQVHCFDAATLEIEYAI 260 (921)
Q Consensus 215 Tg~~V~tL~f~s~V~sV~~S-------~riLAVa~d~~I~IwDl~T~~~l~tL 260 (921)
....+..|.+...|.+|+.- +..|.++....+.+||+..-..++..
T Consensus 37 ~~~~i~~LNin~~italaaG~l~~~~~~D~LliGt~t~llaYDV~~N~d~Fyk 89 (136)
T PF14781_consen 37 QDSDISFLNINQEITALAAGRLKPDDGRDCLLIGTQTSLLAYDVENNSDLFYK 89 (136)
T ss_pred ccCceeEEECCCceEEEEEEecCCCCCcCEEEEeccceEEEEEcccCchhhhh
Confidence 45578889999999998772 47899999999999999877665543
No 370
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=74.85 E-value=20 Score=41.36 Aligned_cols=99 Identities=15% Similarity=0.198 Sum_probs=59.1
Q ss_pred CCCCEEEEEECCCCceEEE-eccCCCCeEEEEECCCCCEEEEEecCC----------CEEEEEeCCCCCCCCCCccCCCC
Q 002446 387 DNVGMVIVRDIVSKNVIAQ-FRAHKSPISALCFDPSGILLVTASVQG----------HNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~-~~aH~~pIsaLaFSPdGtlLATaS~DG----------t~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
.....++|+|+.+++.+.. |..- .-..++|.+||+.|.....+. ..|..|++.+. ..
T Consensus 147 ~e~~~l~v~Dl~tg~~l~d~i~~~--~~~~~~W~~d~~~~~y~~~~~~~~~~~~~~~~~v~~~~~gt~----------~~ 214 (414)
T PF02897_consen 147 SEWYTLRVFDLETGKFLPDGIENP--KFSSVSWSDDGKGFFYTRFDEDQRTSDSGYPRQVYRHKLGTP----------QS 214 (414)
T ss_dssp SSEEEEEEEETTTTEEEEEEEEEE--ESEEEEECTTSSEEEEEECSTTTSS-CCGCCEEEEEEETTS-----------GG
T ss_pred CceEEEEEEECCCCcCcCCccccc--ccceEEEeCCCCEEEEEEeCcccccccCCCCcEEEEEECCCC----------hH
Confidence 3446899999999987653 2321 122399999999877665433 33566666654 01
Q ss_pred ceeEEEEEeccccccc-EEEEEEccCCCEEEEEeCCCc----EEEEecCC
Q 002446 456 SYVHLYRLQRGLTNAV-IQDISFSDDSNWIMISSSRGT----SHLFAINP 500 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~-I~sIaFSPDg~~LAsgS~DgT----VhVWdi~~ 500 (921)
.-..+++- ..... ...+..|+|++||.+.+..++ +++.++..
T Consensus 215 ~d~lvfe~---~~~~~~~~~~~~s~d~~~l~i~~~~~~~~s~v~~~d~~~ 261 (414)
T PF02897_consen 215 EDELVFEE---PDEPFWFVSVSRSKDGRYLFISSSSGTSESEVYLLDLDD 261 (414)
T ss_dssp G-EEEEC----TTCTTSEEEEEE-TTSSEEEEEEESSSSEEEEEEEECCC
T ss_pred hCeeEEee---cCCCcEEEEEEecCcccEEEEEEEccccCCeEEEEeccc
Confidence 11344443 22233 678999999999887655443 45555544
No 371
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=73.36 E-value=49 Score=38.24 Aligned_cols=93 Identities=15% Similarity=0.253 Sum_probs=63.2
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE------
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR------ 462 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~------ 462 (921)
.+.|.+.|..+++++..+..-..| ..++|+|+|+.+..+..+...|.++|.... .+.+
T Consensus 139 ~~~vsvid~~t~~~~~~~~vG~~P-~~~a~~p~g~~vyv~~~~~~~v~vi~~~~~---------------~v~~~~~~~~ 202 (381)
T COG3391 139 NNTVSVIDAATNKVTATIPVGNTP-TGVAVDPDGNKVYVTNSDDNTVSVIDTSGN---------------SVVRGSVGSL 202 (381)
T ss_pred CceEEEEeCCCCeEEEEEecCCCc-ceEEECCCCCeEEEEecCCCeEEEEeCCCc---------------ceeccccccc
Confidence 578999999999988886654456 889999999977776644445899996553 1111
Q ss_pred EecccccccEEEEEEccCCCEEEEEeCC---CcEEEEecCC
Q 002446 463 LQRGLTNAVIQDISFSDDSNWIMISSSR---GTSHLFAINP 500 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSPDg~~LAsgS~D---gTVhVWdi~~ 500 (921)
...+.. -..++++|||+++-+.-.. +++-+.|..+
T Consensus 203 ~~~~~~---P~~i~v~~~g~~~yV~~~~~~~~~v~~id~~~ 240 (381)
T COG3391 203 VGVGTG---PAGIAVDPDGNRVYVANDGSGSNNVLKIDTAT 240 (381)
T ss_pred cccCCC---CceEEECCCCCEEEEEeccCCCceEEEEeCCC
Confidence 111211 3579999999976665443 4666666554
No 372
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=72.65 E-value=25 Score=41.11 Aligned_cols=83 Identities=18% Similarity=0.343 Sum_probs=54.7
Q ss_pred eEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE--ec----ccccccEEEE
Q 002446 402 VIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL--QR----GLTNAVIQDI 475 (921)
Q Consensus 402 ~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l--~R----G~t~a~I~sI 475 (921)
+...+....++|++|+.|.=| ++|.|..+|+ +-|.|+... .-+|+- +. ......|++|
T Consensus 78 P~~l~~~~~g~vtal~~S~iG-Fvaigy~~G~-l~viD~RGP--------------avI~~~~i~~~~~~~~~~~~vt~i 141 (395)
T PF08596_consen 78 PLTLLDAKQGPVTALKNSDIG-FVAIGYESGS-LVVIDLRGP--------------AVIYNENIRESFLSKSSSSYVTSI 141 (395)
T ss_dssp EEEEE---S-SEEEEEE-BTS-EEEEEETTSE-EEEEETTTT--------------EEEEEEEGGG--T-SS----EEEE
T ss_pred chhheeccCCcEeEEecCCCc-EEEEEecCCc-EEEEECCCC--------------eEEeeccccccccccccccCeeEE
Confidence 555666678999999998555 8999999997 899999643 223331 11 1122348889
Q ss_pred EEcc-----CC---CEEEEEeCCCcEEEEecCC
Q 002446 476 SFSD-----DS---NWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 476 aFSP-----Dg---~~LAsgS~DgTVhVWdi~~ 500 (921)
.|+- |+ -.|.+|+..|++.+|.|-+
T Consensus 142 eF~vm~~~~D~ySSi~L~vGTn~G~v~~fkIlp 174 (395)
T PF08596_consen 142 EFSVMTLGGDGYSSICLLVGTNSGNVLTFKILP 174 (395)
T ss_dssp EEEEEE-TTSSSEEEEEEEEETTSEEEEEEEEE
T ss_pred EEEEEecCCCcccceEEEEEeCCCCEEEEEEec
Confidence 8872 33 4688999999999999975
No 373
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=72.58 E-value=1.2e+02 Score=38.39 Aligned_cols=74 Identities=20% Similarity=0.273 Sum_probs=48.6
Q ss_pred CCeEEEEEC--CCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCC---C---
Q 002446 411 SPISALCFD--PSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDS---N--- 482 (921)
Q Consensus 411 ~pIsaLaFS--PdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg---~--- 482 (921)
..+..|++. ...++||.++.. +.|.||-...... . ..+..... ..+.|-+|+|-++. .
T Consensus 164 ~SaWGLdIh~~~~~rlIAVSsNs-~~VTVFaf~l~~~-r---------~~~~~s~~---~~hNIP~VSFl~~~~d~~G~v 229 (717)
T PF08728_consen 164 ASAWGLDIHDYKKSRLIAVSSNS-QEVTVFAFALVDE-R---------FYHVPSHQ---HSHNIPNVSFLDDDLDPNGHV 229 (717)
T ss_pred CceeEEEEEecCcceEEEEecCC-ceEEEEEEecccc-c---------cccccccc---cccCCCeeEeecCCCCCccce
Confidence 367889997 677777766555 5689997665200 0 00101111 22349999996644 2
Q ss_pred EEEEEeCCCcEEEEec
Q 002446 483 WIMISSSRGTSHLFAI 498 (921)
Q Consensus 483 ~LAsgS~DgTVhVWdi 498 (921)
+|++++-.|.+-+|++
T Consensus 230 ~v~a~dI~G~v~~~~I 245 (717)
T PF08728_consen 230 KVVATDISGEVWTFKI 245 (717)
T ss_pred EEEEEeccCcEEEEEE
Confidence 8999999999999988
No 374
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=72.00 E-value=4.7 Score=50.39 Aligned_cols=90 Identities=22% Similarity=0.298 Sum_probs=67.0
Q ss_pred ceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 401 NVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
+...+|+.|+...+|++|+-+-..|+.|+..|. |++|++.+|... .+ + .+| .+.|+-|.=|-|
T Consensus 1092 r~w~~frd~~~~fTc~afs~~~~hL~vG~~~Ge-ik~~nv~sG~~e-----------~s-~---ncH-~SavT~vePs~d 1154 (1516)
T KOG1832|consen 1092 RSWRSFRDETALFTCIAFSGGTNHLAVGSHAGE-IKIFNVSSGSME-----------ES-V---NCH-QSAVTLVEPSVD 1154 (1516)
T ss_pred ccchhhhccccceeeEEeecCCceEEeeeccce-EEEEEccCcccc-----------cc-c---ccc-ccccccccccCC
Confidence 466788999999999999999999999999997 999999987110 00 1 122 344888888899
Q ss_pred CCEEEEEeCCC--cEEEEecCCCCCc-eee
Q 002446 481 SNWIMISSSRG--TSHLFAINPLGGS-VNF 507 (921)
Q Consensus 481 g~~LAsgS~Dg--TVhVWdi~~~g~~-~~l 507 (921)
|..+.+.|.-. -.-+|++...++. +++
T Consensus 1155 gs~~Ltsss~S~PlsaLW~~~s~~~~~Hsf 1184 (1516)
T KOG1832|consen 1155 GSTQLTSSSSSSPLSALWDASSTGGPRHSF 1184 (1516)
T ss_pred cceeeeeccccCchHHHhccccccCccccc
Confidence 98877655433 4789999875554 344
No 375
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=70.44 E-value=90 Score=37.21 Aligned_cols=91 Identities=15% Similarity=0.236 Sum_probs=60.1
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
.++|.+++||+|.+.||.--.+.+ |..++..+... ......+.+- .++.|...+|+.. .-+|..+.
T Consensus 66 ~G~I~SIkFSlDnkilAVQR~~~~-v~f~nf~~d~~----------~l~~~~~ck~--k~~~IlGF~W~~s-~e~A~i~~ 131 (657)
T KOG2377|consen 66 KGEIKSIKFSLDNKILAVQRTSKT-VDFCNFIPDNS----------QLEYTQECKT--KNANILGFCWTSS-TEIAFITD 131 (657)
T ss_pred CCceeEEEeccCcceEEEEecCce-EEEEecCCCch----------hhHHHHHhcc--CcceeEEEEEecC-eeEEEEec
Confidence 468999999999999999888865 88888755310 0111111111 2345999999866 66777776
Q ss_pred CCcEEEEecCCCCCce-eecCCCCCcc
Q 002446 490 RGTSHLFAINPLGGSV-NFQPTDANFT 515 (921)
Q Consensus 490 DgTVhVWdi~~~g~~~-~l~~H~~~~~ 515 (921)
.| +-+|.+.+..... .++.|.-.++
T Consensus 132 ~G-~e~y~v~pekrslRlVks~~~nvn 157 (657)
T KOG2377|consen 132 QG-IEFYQVLPEKRSLRLVKSHNLNVN 157 (657)
T ss_pred CC-eEEEEEchhhhhhhhhhhcccCcc
Confidence 55 7889888765554 3366654444
No 376
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=70.06 E-value=96 Score=30.15 Aligned_cols=88 Identities=15% Similarity=0.243 Sum_probs=57.9
Q ss_pred ccccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 383 FPDADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 383 ~~s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
++-+..|..|+||+-. ..+..+..+. .|++|+-... ..++.|-..|| |-||+-.. .+|+
T Consensus 18 LlvGs~D~~IRvf~~~--e~~~Ei~e~~-~v~~L~~~~~-~~F~Y~l~NGT-VGvY~~~~----------------RlWR 76 (111)
T PF14783_consen 18 LLVGSDDFEIRVFKGD--EIVAEITETD-KVTSLCSLGG-GRFAYALANGT-VGVYDRSQ----------------RLWR 76 (111)
T ss_pred EEEecCCcEEEEEeCC--cEEEEEeccc-ceEEEEEcCC-CEEEEEecCCE-EEEEeCcc----------------eeee
Confidence 3456778999999854 5777777654 5667666665 56899999998 89997543 3444
Q ss_pred EecccccccEEEEEEcc---CCC-EEEEEeCCCcEE
Q 002446 463 LQRGLTNAVIQDISFSD---DSN-WIMISSSRGTSH 494 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSP---Dg~-~LAsgS~DgTVh 494 (921)
.+. ...+.++++.. ||. -|++|-.+|.|-
T Consensus 77 iKS---K~~~~~~~~~D~~gdG~~eLI~GwsnGkve 109 (111)
T PF14783_consen 77 IKS---KNQVTSMAFYDINGDGVPELIVGWSNGKVE 109 (111)
T ss_pred ecc---CCCeEEEEEEcCCCCCceEEEEEecCCeEE
Confidence 432 23366666643 332 477777777664
No 377
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=70.01 E-value=13 Score=28.20 Aligned_cols=31 Identities=13% Similarity=0.270 Sum_probs=20.7
Q ss_pred cCCCCeEEEEECCCCCEEEEEecCC--CEEEEE
Q 002446 408 AHKSPISALCFDPSGILLVTASVQG--HNINIF 438 (921)
Q Consensus 408 aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIW 438 (921)
.......+.+|||||+.|+-++... ....||
T Consensus 6 ~~~~~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 6 NSPGDDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp -SSSSEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred cCCccccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 3445667889999999998887664 335555
No 378
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=70.00 E-value=8.4 Score=48.09 Aligned_cols=56 Identities=18% Similarity=0.337 Sum_probs=47.3
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCC
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKII 441 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~ 441 (921)
.+-.-|.+.+|...+.+.-.....|+.+|.-|.|||||+.|+|+..-|- +.+|..+
T Consensus 76 ~gwe~g~~~v~~~~~~e~htv~~th~a~i~~l~wS~~G~~l~t~d~~g~-v~lwr~d 131 (1416)
T KOG3617|consen 76 QGWEMGVSDVQKTNTTETHTVVETHPAPIQGLDWSHDGTVLMTLDNPGS-VHLWRYD 131 (1416)
T ss_pred hccccceeEEEecCCceeeeeccCCCCCceeEEecCCCCeEEEcCCCce-eEEEEee
Confidence 3445688999998877665555689999999999999999999999985 8999877
No 379
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=69.52 E-value=46 Score=41.25 Aligned_cols=101 Identities=15% Similarity=0.203 Sum_probs=66.0
Q ss_pred CEEEEEECCCCceEEEec-cCCCCeEEEEE--CCCCCEEEEEecCCCEEEEEeCCCC-CCCCCCccCCCCceeEEEEE-e
Q 002446 390 GMVIVRDIVSKNVIAQFR-AHKSPISALCF--DPSGILLVTASVQGHNINIFKIIPG-ILGTSSACDAGTSYVHLYRL-Q 464 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~-aH~~pIsaLaF--SPdGtlLATaS~DGt~IrIWdi~~g-~~~~~s~~~~~~~~~~l~~l-~ 464 (921)
-.+.|||...+.....-. ....+|.+|.| .|||+.+.+-+...+ |.|+.-... .....+ +-..+.++ -
T Consensus 51 ~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d~qsiLaVGf~~~-v~l~~Q~R~dy~~~~p------~w~~i~~i~i 123 (631)
T PF12234_consen 51 SELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPDGQSILAVGFPHH-VLLYTQLRYDYTNKGP------SWAPIRKIDI 123 (631)
T ss_pred CEEEEEEcCCcEEEEeeeecCCCceeeceeeecCCCCEEEEEEcCcE-EEEEEccchhhhcCCc------ccceeEEEEe
Confidence 479999999876433222 44678999876 579999888888866 778754321 001111 11122222 2
Q ss_pred cccccccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 465 RGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 465 RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
+.+|.+.|.+.+|-+||..++.++ +-++||+-.
T Consensus 124 ~~~T~h~Igds~Wl~~G~LvV~sG--Nqlfv~dk~ 156 (631)
T PF12234_consen 124 SSHTPHPIGDSIWLKDGTLVVGSG--NQLFVFDKW 156 (631)
T ss_pred ecCCCCCccceeEecCCeEEEEeC--CEEEEECCC
Confidence 567778899999999998876653 468888743
No 380
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=67.77 E-value=12 Score=40.64 Aligned_cols=104 Identities=13% Similarity=0.113 Sum_probs=65.0
Q ss_pred ccCCCCEEEEEECCCC-ceEEEeccCCCCeEE-EEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 385 DADNVGMVIVRDIVSK-NVIAQFRAHKSPISA-LCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~-~~l~~~~aH~~pIsa-LaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
-+..+|.|.+|...-- .....+..-..+|.+ +.--.++.+..++..+|. ||-|++.++ +++-
T Consensus 75 vG~~dg~v~~~n~n~~g~~~d~~~s~~e~i~~~Ip~~~~~~~~c~~~~dg~-ir~~n~~p~--------------k~~g- 138 (238)
T KOG2444|consen 75 VGTSDGAVYVFNWNLEGAHSDRVCSGEESIDLGIPNGRDSSLGCVGAQDGR-IRACNIKPN--------------KVLG- 138 (238)
T ss_pred eecccceEEEecCCccchHHHhhhcccccceeccccccccceeEEeccCCc-eeeeccccC--------------ceee-
Confidence 3456788988876411 100011111233433 334446678888999986 999999986 2221
Q ss_pred Eeccccc-ccEEEEEEccCCCEEEEE--eCCCcEEEEecCCCCCce
Q 002446 463 LQRGLTN-AVIQDISFSDDSNWIMIS--SSRGTSHLFAINPLGGSV 505 (921)
Q Consensus 463 l~RG~t~-a~I~sIaFSPDg~~LAsg--S~DgTVhVWdi~~~g~~~ 505 (921)
.+|++. ..+....-+..+++|+++ |.|.+++.|++.+.....
T Consensus 139 -~~g~h~~~~~e~~ivv~sd~~i~~a~~S~d~~~k~W~ve~~~d~~ 183 (238)
T KOG2444|consen 139 -YVGQHNFESGEELIVVGSDEFLKIADTSHDRVLKKWNVEKIKDES 183 (238)
T ss_pred -eeccccCCCcceeEEecCCceEEeeccccchhhhhcchhhhhccC
Confidence 234444 556677777788888888 888899999887754443
No 381
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=67.59 E-value=3.8e+02 Score=34.98 Aligned_cols=95 Identities=12% Similarity=0.135 Sum_probs=67.6
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccc
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTN 469 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~ 469 (921)
..|++|+..+.+.+..=..|..++.+|...-.|..+|.|+.-+. |.+-..... ...++++.|-..+
T Consensus 848 ~~vrLye~t~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDlm~S-itll~y~~~-------------eg~f~evArD~~p 913 (1096)
T KOG1897|consen 848 QSVRLYEWTTERELRIECNISNPIIALDLQVKGDEIAVGDLMRS-ITLLQYKGD-------------EGNFEEVARDYNP 913 (1096)
T ss_pred cEEEEEEccccceehhhhcccCCeEEEEEEecCcEEEEeeccce-EEEEEEecc-------------CCceEEeehhhCc
Confidence 47999999998777776788999999999999999999998764 665544332 0124566666665
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
..++.+.+=.|..|+ .+..+|.+.+-..+
T Consensus 914 ~Wmtaveil~~d~yl-gae~~gNlf~v~~d 942 (1096)
T KOG1897|consen 914 NWMTAVEILDDDTYL-GAENSGNLFTVRKD 942 (1096)
T ss_pred cceeeEEEecCceEE-eecccccEEEEEec
Confidence 557777776565555 44556777666554
No 382
>PF07676 PD40: WD40-like Beta Propeller Repeat; InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=65.77 E-value=12 Score=28.36 Aligned_cols=26 Identities=23% Similarity=0.438 Sum_probs=19.3
Q ss_pred cEEEEEEccCCCEEEEEeCC---CcEEEE
Q 002446 471 VIQDISFSDDSNWIMISSSR---GTSHLF 496 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~D---gTVhVW 496 (921)
.....+|||||++|+-++.. |...||
T Consensus 10 ~~~~p~~SpDGk~i~f~s~~~~~g~~diy 38 (39)
T PF07676_consen 10 DDGSPAWSPDGKYIYFTSNRNDRGSFDIY 38 (39)
T ss_dssp SEEEEEE-TTSSEEEEEEECT--SSEEEE
T ss_pred cccCEEEecCCCEEEEEecCCCCCCcCEE
Confidence 36788999999999877665 566666
No 383
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=60.96 E-value=34 Score=44.61 Aligned_cols=67 Identities=16% Similarity=0.152 Sum_probs=50.5
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
..|.++.|--++.-+..+..+|. |.+-|..+. ....+ |....-|.+++||||.+++|..+.+
T Consensus 69 ~~i~s~~fl~d~~~i~v~~~~G~-iilvd~et~------------~~eiv-----g~vd~GI~aaswS~Dee~l~liT~~ 130 (1265)
T KOG1920|consen 69 DEIVSVQFLADTNSICVITALGD-IILVDPETL------------ELEIV-----GNVDNGISAASWSPDEELLALITGR 130 (1265)
T ss_pred cceEEEEEecccceEEEEecCCc-EEEEccccc------------ceeee-----eeccCceEEEeecCCCcEEEEEeCC
Confidence 47889999999999999999998 455566553 11111 3233339999999999999999999
Q ss_pred CcEEE
Q 002446 491 GTSHL 495 (921)
Q Consensus 491 gTVhV 495 (921)
+|+.+
T Consensus 131 ~tll~ 135 (1265)
T KOG1920|consen 131 QTLLF 135 (1265)
T ss_pred cEEEE
Confidence 98865
No 384
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=60.69 E-value=71 Score=34.85 Aligned_cols=75 Identities=12% Similarity=0.199 Sum_probs=47.7
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEe-CCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC-
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFK-IIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS- 489 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWd-i~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~- 489 (921)
.++.-+|+++|.+.+....+.. .+++. ...+ .... ..+........|.++.+||||..+|....
T Consensus 67 ~l~~PS~d~~g~~W~v~~~~~~-~~~~~~~~~g------------~~~~-~~v~~~~~~~~I~~l~vSpDG~RvA~v~~~ 132 (253)
T PF10647_consen 67 SLTRPSWDPDGWVWTVDDGSGG-VRVVRDSASG------------TGEP-VEVDWPGLRGRITALRVSPDGTRVAVVVED 132 (253)
T ss_pred ccccccccCCCCEEEEEcCCCc-eEEEEecCCC------------ccee-EEecccccCCceEEEEECCCCcEEEEEEec
Confidence 7788899999998887776654 56664 2222 0011 11111111116999999999999998873
Q ss_pred --CCcEEEEecCC
Q 002446 490 --RGTSHLFAINP 500 (921)
Q Consensus 490 --DgTVhVWdi~~ 500 (921)
++.|.|=.|..
T Consensus 133 ~~~~~v~va~V~r 145 (253)
T PF10647_consen 133 GGGGRVYVAGVVR 145 (253)
T ss_pred CCCCeEEEEEEEe
Confidence 46777766653
No 385
>smart00036 CNH Domain found in NIK1-like kinases, mouse citron and yeast ROM1, ROM2. Unpublished observations.
Probab=60.64 E-value=1.4e+02 Score=33.40 Aligned_cols=43 Identities=12% Similarity=-0.002 Sum_probs=35.0
Q ss_pred EEEeCCCCEEEEEEcCCEEEEEeCCEEEEEECCCCcEEEEEec
Q 002446 220 HMLKFRSPIYSVRCSSRVVAICQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 220 ~tL~f~s~V~sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t 262 (921)
..|.+.....++++...+|.+..++-|.|+++.+++.++++..
T Consensus 238 ~~l~w~~~p~~~~~~~pyll~~~~~~ievr~l~~~~l~q~i~~ 280 (302)
T smart00036 238 PILHWEFMPESFAYHSPYLLAFHDNGIEIRSIKTGELLQELAD 280 (302)
T ss_pred eEEEcCCcccEEEEECCEEEEEcCCcEEEEECCCCceEEEEec
Confidence 3567778888888987777776788899999999998888753
No 386
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=58.48 E-value=1.2e+02 Score=36.72 Aligned_cols=87 Identities=10% Similarity=0.291 Sum_probs=53.9
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCC-Cc--------eeEEEEEecccccccEEEEEEccCC
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAG-TS--------YVHLYRLQRGLTNAVIQDISFSDDS 481 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~-~~--------~~~l~~l~RG~t~a~I~sIaFSPDg 481 (921)
-.|..+..||.|...|-++.+| |.|-.+... .|..+-..-+ .. ...+|+- .+.-.+...+|.|++
T Consensus 104 feV~~vl~s~~GS~VaL~G~~G--i~vMeLp~r-wG~~s~~eDgk~~v~CRt~~i~~~~fts---s~~ltl~Qa~WHP~S 177 (741)
T KOG4460|consen 104 FEVYQVLLSPTGSHVALIGIKG--LMVMELPKR-WGKNSEFEDGKSTVNCRTTPVAERFFTS---STSLTLKQAAWHPSS 177 (741)
T ss_pred EEEEEEEecCCCceEEEecCCe--eEEEEchhh-cCccceecCCCceEEEEeecccceeecc---CCceeeeeccccCCc
Confidence 3567788999999999999998 455555321 1111110000 00 0112221 122237789999987
Q ss_pred ---CEEEEEeCCCcEEEEecCCCCC
Q 002446 482 ---NWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 482 ---~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
..|..=+.|.+++||+++....
T Consensus 178 ~~D~hL~iL~sdnviRiy~lS~~te 202 (741)
T KOG4460|consen 178 ILDPHLVLLTSDNVIRIYSLSEPTE 202 (741)
T ss_pred cCCceEEEEecCcEEEEEecCCcch
Confidence 6788888999999999987543
No 387
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=57.01 E-value=93 Score=36.41 Aligned_cols=99 Identities=19% Similarity=0.250 Sum_probs=46.4
Q ss_pred CCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCC---------------CEEEEEeCCCCCCCCCCccC
Q 002446 388 NVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQG---------------HNINIFKIIPGILGTSSACD 452 (921)
Q Consensus 388 ~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DG---------------t~IrIWdi~~g~~~~~s~~~ 452 (921)
.+-.|.=+|+.+++...... ..+...+--|+||+++|-=+.|. ..|.||++..+
T Consensus 262 ~~~~i~~~d~~t~~~~~~~~--~p~~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~~~~p~i~~~~~~~~--------- 330 (386)
T PF14583_consen 262 QDFWIAGYDPDTGERRRLME--MPWCSHFMSSPDGKLFVGDGGDAPVDVADAGGYKIENDPWIYLFDVEAG--------- 330 (386)
T ss_dssp --EEEEEE-TTT--EEEEEE--E-SEEEEEE-TTSSEEEEEE-------------------EEEEEETTTT---------
T ss_pred CceEEEeeCCCCCCceEEEe--CCceeeeEEcCCCCEEEecCCCCCccccccccceecCCcEEEEeccccC---------
Confidence 34466677888775432221 23566788899999887533321 13566777654
Q ss_pred CCCceeEEEE------EecccccccEEEEEEccCCCEEEE-EeCCCcEEEEecCC
Q 002446 453 AGTSYVHLYR------LQRGLTNAVIQDISFSDDSNWIMI-SSSRGTSHLFAINP 500 (921)
Q Consensus 453 ~~~~~~~l~~------l~RG~t~a~I~sIaFSPDg~~LAs-gS~DgTVhVWdi~~ 500 (921)
....+.. ...|.....=--..|||||+||.- +...|..+||-+.-
T Consensus 331 ---~~~~l~~h~~sw~v~~~~~q~~hPhp~FSPDgk~VlF~Sd~~G~~~vY~v~i 382 (386)
T PF14583_consen 331 ---RFRKLARHDTSWKVLDGDRQVTHPHPSFSPDGKWVLFRSDMEGPPAVYLVEI 382 (386)
T ss_dssp ---EEEEEEE-------BTTBSSTT----EE-TTSSEEEEEE-TTSS-EEEEEE-
T ss_pred ---ceeeeeeccCcceeecCCCccCCCCCccCCCCCEEEEECCCCCCccEEEEeC
Confidence 1111111 111211111135889999999875 55678888887653
No 388
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=55.74 E-value=73 Score=36.07 Aligned_cols=70 Identities=17% Similarity=0.237 Sum_probs=39.6
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
.+.+..+..++||+++|.+ ..|..+.-||--. ..++.+. |. +..+|++|.|+||+...+++ .
T Consensus 144 ~gs~~~~~r~~dG~~vavs-~~G~~~~s~~~G~-------------~~w~~~~--r~-~~~riq~~gf~~~~~lw~~~-~ 205 (302)
T PF14870_consen 144 SGSINDITRSSDGRYVAVS-SRGNFYSSWDPGQ-------------TTWQPHN--RN-SSRRIQSMGFSPDGNLWMLA-R 205 (302)
T ss_dssp ---EEEEEE-TTS-EEEEE-TTSSEEEEE-TT--------------SS-EEEE-----SSS-EEEEEE-TTS-EEEEE-T
T ss_pred cceeEeEEECCCCcEEEEE-CcccEEEEecCCC-------------ccceEEc--cC-ccceehhceecCCCCEEEEe-C
Confidence 3678889999999988876 5677666665332 1233333 33 34569999999998876655 6
Q ss_pred CCcEEEEe
Q 002446 490 RGTSHLFA 497 (921)
Q Consensus 490 DgTVhVWd 497 (921)
.|-++.=+
T Consensus 206 Gg~~~~s~ 213 (302)
T PF14870_consen 206 GGQIQFSD 213 (302)
T ss_dssp TTEEEEEE
T ss_pred CcEEEEcc
Confidence 66666544
No 389
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=54.17 E-value=1.8e+02 Score=29.27 Aligned_cols=56 Identities=16% Similarity=0.220 Sum_probs=44.5
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc------CCEEEEEeCCEEEEEECCCCcEEEEEe
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS------SRVVAICQAAQVHCFDAATLEIEYAIL 261 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S------~riLAVa~d~~I~IwDl~T~~~l~tL~ 261 (921)
+.|..||.....-+.--+.+..|.+|.+- ..++.|.....|.-||..-.+..+++.
T Consensus 73 t~llaYDV~~N~d~Fyke~~DGvn~i~~g~~~~~~~~l~ivGGncsi~Gfd~~G~e~fWtVt 134 (136)
T PF14781_consen 73 TSLLAYDVENNSDLFYKEVPDGVNAIVIGKLGDIPSPLVIVGGNCSIQGFDYEGNEIFWTVT 134 (136)
T ss_pred ceEEEEEcccCchhhhhhCccceeEEEEEecCCCCCcEEEECceEEEEEeCCCCcEEEEEec
Confidence 67999999988877766778889999882 456667777899999988777777653
No 390
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=54.15 E-value=30 Score=41.19 Aligned_cols=46 Identities=13% Similarity=0.260 Sum_probs=31.9
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEc--CCEEEEEeCCEEEEEECC
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCS--SRVVAICQAAQVHCFDAA 252 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S--~riLAVa~d~~I~IwDl~ 252 (921)
..|.|||..+++.+..+.++. |..|.+| +.+||...+..|+|++..
T Consensus 126 ~~i~~yDw~~~~~i~~i~v~~-vk~V~Ws~~g~~val~t~~~i~il~~~ 173 (443)
T PF04053_consen 126 DFICFYDWETGKLIRRIDVSA-VKYVIWSDDGELVALVTKDSIYILKYN 173 (443)
T ss_dssp TEEEEE-TTT--EEEEESS-E--EEEEE-TTSSEEEEE-S-SEEEEEE-
T ss_pred CCEEEEEhhHcceeeEEecCC-CcEEEEECCCCEEEEEeCCeEEEEEec
Confidence 469999999999999999875 8999997 578998888888887743
No 391
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=53.59 E-value=1.1e+02 Score=38.17 Aligned_cols=79 Identities=15% Similarity=0.158 Sum_probs=53.5
Q ss_pred EeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEE--ccCCC
Q 002446 405 QFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISF--SDDSN 482 (921)
Q Consensus 405 ~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaF--SPDg~ 482 (921)
++..--...+-+.-|.-++ +|..+.+++.+.|||+..+ ...|+-.- .....|.++.| .|||+
T Consensus 24 ~~~T~i~~~~li~gss~~k-~a~V~~~~~~LtIWD~~~~--------------~lE~~~~f-~~~~~I~dLDWtst~d~q 87 (631)
T PF12234_consen 24 TFETGISNPSLISGSSIKK-IAVVDSSRSELTIWDTRSG--------------VLEYEESF-SEDDPIRDLDWTSTPDGQ 87 (631)
T ss_pred EEecCCCCcceEeecccCc-EEEEECCCCEEEEEEcCCc--------------EEEEeeee-cCCCceeeceeeecCCCC
Confidence 3433334556666666555 5555777888999999875 22222211 11235999999 58999
Q ss_pred EEEEEeCCCcEEEEecC
Q 002446 483 WIMISSSRGTSHLFAIN 499 (921)
Q Consensus 483 ~LAsgS~DgTVhVWdi~ 499 (921)
.+.+.+-...|.|+.--
T Consensus 88 siLaVGf~~~v~l~~Q~ 104 (631)
T PF12234_consen 88 SILAVGFPHHVLLYTQL 104 (631)
T ss_pred EEEEEEcCcEEEEEEcc
Confidence 99999999999998654
No 392
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=52.27 E-value=38 Score=40.76 Aligned_cols=27 Identities=19% Similarity=0.475 Sum_probs=20.6
Q ss_pred cEEEEEEccCCCEEEEEeCCCcEEEEec
Q 002446 471 VIQDISFSDDSNWIMISSSRGTSHLFAI 498 (921)
Q Consensus 471 ~I~sIaFSPDg~~LAsgS~DgTVhVWdi 498 (921)
.|.-|.-+.||+||...+ +.++-|-++
T Consensus 473 ~I~hVdvtadGKwil~Tc-~tyLlLi~t 499 (644)
T KOG2395|consen 473 AIKHVDVTADGKWILATC-KTYLLLIDT 499 (644)
T ss_pred ceeeEEeeccCcEEEEec-ccEEEEEEE
Confidence 488899999999997765 556666554
No 393
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=51.80 E-value=25 Score=43.39 Aligned_cols=76 Identities=16% Similarity=0.269 Sum_probs=56.9
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 410 KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
...|.--||+-.+++|+.|+.-|- +.+|+-..+ ...+++. .| ....+..++.|++..++|.|+.
T Consensus 33 ~~~v~lTc~dst~~~l~~GsS~G~-lyl~~R~~~-------------~~~~~~~-~~-~~~~~~~~~vs~~e~lvAagt~ 96 (726)
T KOG3621|consen 33 PARVKLTCVDATEEYLAMGSSAGS-VYLYNRHTG-------------EMRKLKN-EG-ATGITCVRSVSSVEYLVAAGTA 96 (726)
T ss_pred cceEEEEEeecCCceEEEecccce-EEEEecCch-------------hhhcccc-cC-ccceEEEEEecchhHhhhhhcC
Confidence 345566688999999999999985 889976654 1122222 12 2233777889999999999999
Q ss_pred CCcEEEEecCCC
Q 002446 490 RGTSHLFAINPL 501 (921)
Q Consensus 490 DgTVhVWdi~~~ 501 (921)
.|-|-||.++..
T Consensus 97 ~g~V~v~ql~~~ 108 (726)
T KOG3621|consen 97 SGRVSVFQLNKE 108 (726)
T ss_pred CceEEeehhhcc
Confidence 999999999983
No 394
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=51.69 E-value=82 Score=23.71 Aligned_cols=24 Identities=13% Similarity=0.337 Sum_probs=18.8
Q ss_pred CCCCEEEEEecCCCEEEEEeCCCC
Q 002446 420 PSGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 420 PdGtlLATaS~DGt~IrIWdi~~g 443 (921)
|||+.|..+......|.++|+.+.
T Consensus 1 pd~~~lyv~~~~~~~v~~id~~~~ 24 (42)
T TIGR02276 1 PDGTKLYVTNSGSNTVSVIDTATN 24 (42)
T ss_pred CCCCEEEEEeCCCCEEEEEECCCC
Confidence 688888877766667999998764
No 395
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=51.63 E-value=1.8e+02 Score=32.93 Aligned_cols=54 Identities=13% Similarity=0.114 Sum_probs=39.4
Q ss_pred EEEEECCCCcEEEEEeCCCCEEEEEEc---CCEEEEEe--CCEEEEEECCCCcEEEEEec
Q 002446 208 VHFYSLRSQSYVHMLKFRSPIYSVRCS---SRVVAICQ--AAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 208 VrIWDL~Tg~~V~tL~f~s~V~sV~~S---~riLAVa~--d~~I~IwDl~T~~~l~tL~t 262 (921)
+-.++. .|+++..+..+..-..|.++ ++-|+++- ...-.+||..+.+.+.++..
T Consensus 51 ~a~~~e-aGk~v~~~~lpaR~Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s 109 (366)
T COG3490 51 AATLSE-AGKIVFATALPARGHGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVS 109 (366)
T ss_pred EEEEcc-CCceeeeeecccccCCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEec
Confidence 334443 68899999888888889996 46666643 34788999999888777653
No 396
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=51.08 E-value=85 Score=34.97 Aligned_cols=86 Identities=13% Similarity=0.038 Sum_probs=57.9
Q ss_pred cCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEec
Q 002446 386 ADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQR 465 (921)
Q Consensus 386 ~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~R 465 (921)
+...|.+.+.+..+|..+..|..-..-=..-..++||.++-.++.||+ +..-|..+. .++|+.+-
T Consensus 69 GCy~g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~glIycgshd~~-~yalD~~~~--------------~cVykskc 133 (354)
T KOG4649|consen 69 GCYSGGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGLIYCGSHDGN-FYALDPKTY--------------GCVYKSKC 133 (354)
T ss_pred EEccCcEEEEEecchhheeeeeehhhhccceEEcCCCceEEEecCCCc-EEEeccccc--------------ceEEeccc
Confidence 456788999999999877777644322223457899999999999997 777777764 46777765
Q ss_pred ccccccEEEEEEcc-CCCEEEEEe
Q 002446 466 GLTNAVIQDISFSD-DSNWIMISS 488 (921)
Q Consensus 466 G~t~a~I~sIaFSP-Dg~~LAsgS 488 (921)
|-+. -.+=+..| |+...++..
T Consensus 134 gG~~--f~sP~i~~g~~sly~a~t 155 (354)
T KOG4649|consen 134 GGGT--FVSPVIAPGDGSLYAAIT 155 (354)
T ss_pred CCce--eccceecCCCceEEEEec
Confidence 5432 23344555 555554443
No 397
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=49.88 E-value=4.2e+02 Score=29.80 Aligned_cols=56 Identities=9% Similarity=0.111 Sum_probs=40.8
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEE---EEEEcCCEEEE-EeCCEEEEEECCCCcEEEEEe
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIY---SVRCSSRVVAI-CQAAQVHCFDAATLEIEYAIL 261 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~---sV~~S~riLAV-a~d~~I~IwDl~T~~~l~tL~ 261 (921)
+.+.|.+.+||+.+..+.--..|. .+++++.++=. +.|.+.|..|..+..+++..+
T Consensus 73 g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~cVyksk 132 (354)
T KOG4649|consen 73 GGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYGCVYKSK 132 (354)
T ss_pred CcEEEEEecchhheeeeeehhhhccceEEcCCCceEEEecCCCcEEEecccccceEEecc
Confidence 568899999998777665433332 23445666554 788999999999999988854
No 398
>PF12657 TFIIIC_delta: Transcription factor IIIC subunit delta N-term; InterPro: IPR024761 This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=49.84 E-value=1.2e+02 Score=31.14 Aligned_cols=30 Identities=13% Similarity=0.225 Sum_probs=25.1
Q ss_pred cEEEEEEccCC------CEEEEEeCCCcEEEEecCC
Q 002446 471 VIQDISFSDDS------NWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 471 ~I~sIaFSPDg------~~LAsgS~DgTVhVWdi~~ 500 (921)
.|..++|||-| -.||+-+.++.+.||.-..
T Consensus 87 ~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~ 122 (173)
T PF12657_consen 87 QVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPG 122 (173)
T ss_pred cEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCC
Confidence 58999999954 2689999999999998654
No 399
>COG5422 ROM1 RhoGEF, Guanine nucleotide exchange factor for Rho/Rac/Cdc42-like GTPases [Signal transduction mechanisms]
Probab=48.18 E-value=1.5e+02 Score=37.91 Aligned_cols=35 Identities=14% Similarity=0.018 Sum_probs=26.8
Q ss_pred EEEEEcCCEEEEEeCCEEEEEECCCCcEEEEEecC
Q 002446 229 YSVRCSSRVVAICQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 229 ~sV~~S~riLAVa~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
...+++-.+|..-..+-|.|++++|+++++++.++
T Consensus 1102 q~FalsypYIlaf~~~fIeIr~ieTgeLI~~ilg~ 1136 (1175)
T COG5422 1102 QEFALSYPYILAFEPNFIEIRHIETGELIRCILGH 1136 (1175)
T ss_pred ceeeeecceEEEecCceEEEEecccceeeeeeccC
Confidence 34455655665555678999999999999999876
No 400
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=45.56 E-value=1.2e+02 Score=32.62 Aligned_cols=75 Identities=16% Similarity=0.224 Sum_probs=46.6
Q ss_pred ECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE----ecccccccEEEEEEccCCCEEEEEeCCCcE
Q 002446 418 FDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL----QRGLTNAVIQDISFSDDSNWIMISSSRGTS 493 (921)
Q Consensus 418 FSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l----~RG~t~a~I~sIaFSPDg~~LAsgS~DgTV 493 (921)
+..+|.+|+.-..+|. ++|||+.....--... +...+..- .+ .....|..+.++.+|.-|++-+ +|..
T Consensus 18 l~~~~~~Ll~iT~~G~-l~vWnl~~~k~~~~~~-----Si~pll~~~~~~~~-~~~~~i~~~~lt~~G~PiV~ls-ng~~ 89 (219)
T PF07569_consen 18 LECNGSYLLAITSSGL-LYVWNLKKGKAVLPPV-----SIAPLLNSSPVSDK-SSSPNITSCSLTSNGVPIVTLS-NGDS 89 (219)
T ss_pred EEeCCCEEEEEeCCCe-EEEEECCCCeeccCCc-----cHHHHhcccccccC-CCCCcEEEEEEcCCCCEEEEEe-CCCE
Confidence 4567888998899997 8999999862100000 00010000 00 1223489999999999887765 4778
Q ss_pred EEEecCC
Q 002446 494 HLFAINP 500 (921)
Q Consensus 494 hVWdi~~ 500 (921)
..|+.+-
T Consensus 90 y~y~~~L 96 (219)
T PF07569_consen 90 YSYSPDL 96 (219)
T ss_pred EEecccc
Confidence 8888754
No 401
>PF05787 DUF839: Bacterial protein of unknown function (DUF839); InterPro: IPR008557 This family consists of bacterial proteins of unknown function.
Probab=44.69 E-value=43 Score=40.70 Aligned_cols=70 Identities=27% Similarity=0.380 Sum_probs=39.3
Q ss_pred EEEECCCCCEEEEEecCCCEEE---------EEeCCCCCCCCC-CccCCCCceeEEEEEecccccccEEEEEEccCCCEE
Q 002446 415 ALCFDPSGILLVTASVQGHNIN---------IFKIIPGILGTS-SACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWI 484 (921)
Q Consensus 415 aLaFSPdGtlLATaS~DGt~Ir---------IWdi~~g~~~~~-s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~L 484 (921)
.|+|+|+|.+++.-+..+...+ +|++... .|.. ... .....++..+-.+...+.++.++|+||++.|
T Consensus 440 NL~~d~~G~LwI~eD~~~~~~~l~g~t~~G~~~~~~~~-~G~~~~~~--~~~~g~~~rf~~~P~gaE~tG~~fspDg~tl 516 (524)
T PF05787_consen 440 NLAFDPDGNLWIQEDGGGSNNNLPGVTPDGEVYDFARN-DGNNVWAY--DPDTGELKRFLVGPNGAEITGPCFSPDGRTL 516 (524)
T ss_pred ceEECCCCCEEEEeCCCCCCcccccccccCceeeeeec-ccceeeec--cccccceeeeccCCCCcccccceECCCCCEE
Confidence 3899999998887655543222 1222110 0000 000 0011234455566677889999999999987
Q ss_pred EEE
Q 002446 485 MIS 487 (921)
Q Consensus 485 Asg 487 (921)
.+.
T Consensus 517 Fvn 519 (524)
T PF05787_consen 517 FVN 519 (524)
T ss_pred EEE
Confidence 653
No 402
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=44.26 E-value=2.4e+02 Score=31.05 Aligned_cols=82 Identities=15% Similarity=0.275 Sum_probs=45.8
Q ss_pred EeccCCCCeEEEEECCCCC-EEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCE
Q 002446 405 QFRAHKSPISALCFDPSGI-LLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNW 483 (921)
Q Consensus 405 ~~~aH~~pIsaLaFSPdGt-lLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~ 483 (921)
.+.+-...++.|+|+|+.. ++|+....+. |...+.. + .....+.+ .|. ...-.|++.-+++|
T Consensus 16 ~l~g~~~e~SGLTy~pd~~tLfaV~d~~~~-i~els~~-G------------~vlr~i~l-~g~--~D~EgI~y~g~~~~ 78 (248)
T PF06977_consen 16 PLPGILDELSGLTYNPDTGTLFAVQDEPGE-IYELSLD-G------------KVLRRIPL-DGF--GDYEGITYLGNGRY 78 (248)
T ss_dssp E-TT--S-EEEEEEETTTTEEEEEETTTTE-EEEEETT---------------EEEEEE--SS---SSEEEEEE-STTEE
T ss_pred ECCCccCCccccEEcCCCCeEEEEECCCCE-EEEEcCC-C------------CEEEEEeC-CCC--CCceeEEEECCCEE
Confidence 3444455699999999755 5555555543 5444542 2 12222333 232 35789999988877
Q ss_pred EEEEeCCCcEEEEecCCCCC
Q 002446 484 IMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 484 LAsgS~DgTVhVWdi~~~g~ 503 (921)
+++.-.++++.++++...+.
T Consensus 79 vl~~Er~~~L~~~~~~~~~~ 98 (248)
T PF06977_consen 79 VLSEERDQRLYIFTIDDDTT 98 (248)
T ss_dssp EEEETTTTEEEEEEE----T
T ss_pred EEEEcCCCcEEEEEEecccc
Confidence 77666699999999966544
No 403
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=44.23 E-value=6.8e+02 Score=31.99 Aligned_cols=74 Identities=14% Similarity=0.115 Sum_probs=49.1
Q ss_pred CCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC--CCEEEEEe
Q 002446 411 SPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD--SNWIMISS 488 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD--g~~LAsgS 488 (921)
+....+.|.++-+.|+.++.. .+.++|+.+.. ...+ +-...+...|.++.=+|+ +..|+..+
T Consensus 204 s~w~rI~W~~~~~~lLv~~r~--~l~~~d~~~~~------------~~~~--l~~~~~~~~IlDv~~~~~~~~~~FiLTs 267 (765)
T PF10214_consen 204 SNWKRILWVSDSNRLLVCNRS--KLMLIDFESNW------------QTEY--LVTAKTWSWILDVKRSPDNPSHVFILTS 267 (765)
T ss_pred CcceeeEecCCCCEEEEEcCC--ceEEEECCCCC------------ccch--hccCCChhheeeEEecCCccceEEEEec
Confidence 345578999998888888776 38999998751 1111 222223345999999998 55555554
Q ss_pred CCCcEEEEecCCCC
Q 002446 489 SRGTSHLFAINPLG 502 (921)
Q Consensus 489 ~DgTVhVWdi~~~g 502 (921)
..|..+++.+..
T Consensus 268 --~eiiw~~~~~~~ 279 (765)
T PF10214_consen 268 --KEIIWLDVKSSS 279 (765)
T ss_pred --CeEEEEEccCCC
Confidence 468788887743
No 404
>PF01731 Arylesterase: Arylesterase; InterPro: IPR002640 The serum paraoxonases/arylesterases are enzymes that catalyse the hydrolysis of the toxic metabolites of a variety of organophosphorus insecticides. The enzymes hydrolyse a broad spectrum of organophosphate substrates, including paraoxon and a number of aromatic carboxylic acid esters (e.g., phenyl acetate), and hence confer resistance to organophosphate toxicity []. Mammals have 3 distinct paraoxonase types, termed PON1-3 [, ]. In mice and humans, the PON genes are found on the same chromosome in close proximity. PON activity has been found in variety of tissues, with highest levels in liver and serum - the source of serum PON is thought to be the liver. Unlike mammals, fish and avian species lack paraoxonase activity. Human and rabbit PONs appear to have two distinct Ca2+ binding sites, one required for stability and one required for catalytic activity. The Ca2+ dependency of PONs suggests a mechanism of hydrolysis where Ca2+ acts as the electrophillic catalyst, like that proposed for phospholipase A2. The paraoxonase enzymes, PON1 and PON3, are high density lipoprotein (HDL)- associated proteins capable of preventing oxidative modification of low density lipoproteins (LPL) []. Although PON2 has oxidative properties, the enzyme does not associate with HDL. Within a given species, PON1, PON2 and PON3 share ~60% amino acid sequence identity, whereas between mammalian species particular PONs (1,2 or 3) share 79-90% identity at the amino acid level. Human PON1 and PON3 share numerous conserved phosphorylation and N-glycosylation sites; however, it is not known whether the PON proteins are modified at these sites, or whether modification at these sites is required for activity in vivo []. This family consists of arylesterases (Also known as serum paraoxonase) 3.1.1.2 from EC. These enzymes hydrolyse organophosphorus esters such as paraoxon and are found in the liver and blood. They confer resistance to organophosphate toxicity []. Human arylesterase (PON1) P27169 from SWISSPROT is associated with HDL and may protect against LDL oxidation [].; GO: 0004064 arylesterase activity
Probab=43.74 E-value=1e+02 Score=28.53 Aligned_cols=50 Identities=24% Similarity=0.234 Sum_probs=34.5
Q ss_pred CEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCC
Q 002446 390 GMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIP 442 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~ 442 (921)
|.|..||...-+. ...+ -..-+.|.+||++++|..++.-+..|++|....
T Consensus 36 ~~Vvyyd~~~~~~--va~g-~~~aNGI~~s~~~k~lyVa~~~~~~I~vy~~~~ 85 (86)
T PF01731_consen 36 GNVVYYDGKEVKV--VASG-FSFANGIAISPDKKYLYVASSLAHSIHVYKRHK 85 (86)
T ss_pred ceEEEEeCCEeEE--eecc-CCCCceEEEcCCCCEEEEEeccCCeEEEEEecC
Confidence 5677788643222 2222 233467899999999999998878899987653
No 405
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=42.54 E-value=1.8e+02 Score=37.17 Aligned_cols=95 Identities=16% Similarity=0.203 Sum_probs=60.3
Q ss_pred CEEEEEECCCC------ceEE--Eecc-----CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCc
Q 002446 390 GMVIVRDIVSK------NVIA--QFRA-----HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTS 456 (921)
Q Consensus 390 G~V~IwDl~s~------~~l~--~~~a-----H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~ 456 (921)
-.|+|||+..- .++. .+-. ...|+++|+.+-|=+.+|.|=.+|. |..+.-+.- +... .
T Consensus 92 ~llkiw~lek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~~l~~Iv~Gf~nG~-V~~~~GDi~-RDrg-------s 162 (933)
T KOG2114|consen 92 VLLKIWDLEKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSEDLKTIVCGFTNGL-VICYKGDIL-RDRG-------S 162 (933)
T ss_pred eEEEEecccccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEccccEEEEEecCcE-EEEEcCcch-hccc-------c
Confidence 47999998632 2331 1112 3568999999999999999999997 445433221 1110 0
Q ss_pred eeEEEEEecccccccEEEEEEccCCCE--EEEEeCCCcEEEEecC
Q 002446 457 YVHLYRLQRGLTNAVIQDISFSDDSNW--IMISSSRGTSHLFAIN 499 (921)
Q Consensus 457 ~~~l~~l~RG~t~a~I~sIaFSPDg~~--LAsgS~DgTVhVWdi~ 499 (921)
+..+. ++|. ..|+.++|-.|++- +|+.+ ..|++|.+.
T Consensus 163 -r~~~~-~~~~--~pITgL~~~~d~~s~lFv~Tt--~~V~~y~l~ 201 (933)
T KOG2114|consen 163 -RQDYS-HRGK--EPITGLALRSDGKSVLFVATT--EQVMLYSLS 201 (933)
T ss_pred -ceeee-ccCC--CCceeeEEecCCceeEEEEec--ceeEEEEec
Confidence 22222 3443 34999999999887 44443 369999998
No 406
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=41.26 E-value=1e+02 Score=37.20 Aligned_cols=36 Identities=11% Similarity=0.205 Sum_probs=28.3
Q ss_pred EEEEEEcc----CCCEEEEEeCCCcEEEEecCCCCCceee
Q 002446 472 IQDISFSD----DSNWIMISSSRGTSHLFAINPLGGSVNF 507 (921)
Q Consensus 472 I~sIaFSP----Dg~~LAsgS~DgTVhVWdi~~~g~~~~l 507 (921)
+.++++++ +..+|++-+.|+++|||++.+.......
T Consensus 217 ~~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~~~~~~ 256 (547)
T PF11715_consen 217 AASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQCLATI 256 (547)
T ss_dssp EEEEEE-----ETTTEEEEEETTSEEEEEETTTTCEEEEE
T ss_pred cceEEEecceeCCCCEEEEEeCCCeEEEEECCCCeEEEEe
Confidence 56677776 8899999999999999999998664443
No 407
>PRK10115 protease 2; Provisional
Probab=40.60 E-value=1.1e+02 Score=38.32 Aligned_cols=73 Identities=12% Similarity=0.088 Sum_probs=45.2
Q ss_pred CCeEEEEECCCCCEEEEEecCC----CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEE
Q 002446 411 SPISALCFDPSGILLVTASVQG----HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMI 486 (921)
Q Consensus 411 ~pIsaLaFSPdGtlLATaS~DG----t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAs 486 (921)
-.+..+.+||||++||-+-+.+ ..|+|-|+.++ ..+-+ .....+ ..++|++|++.|..
T Consensus 127 ~~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg--------------~~l~~---~i~~~~-~~~~w~~D~~~~~y 188 (686)
T PRK10115 127 YTLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETG--------------NWYPE---LLDNVE-PSFVWANDSWTFYY 188 (686)
T ss_pred EEEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCC--------------CCCCc---cccCcc-eEEEEeeCCCEEEE
Confidence 3577789999999988775442 23777777765 10101 111112 45999999998877
Q ss_pred EeCCC------cEEEEecCCC
Q 002446 487 SSSRG------TSHLFAINPL 501 (921)
Q Consensus 487 gS~Dg------TVhVWdi~~~ 501 (921)
+..+. .|..+++.+.
T Consensus 189 ~~~~~~~~~~~~v~~h~lgt~ 209 (686)
T PRK10115 189 VRKHPVTLLPYQVWRHTIGTP 209 (686)
T ss_pred EEecCCCCCCCEEEEEECCCC
Confidence 76542 3555556554
No 408
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=39.81 E-value=1.4e+02 Score=33.21 Aligned_cols=57 Identities=7% Similarity=0.124 Sum_probs=43.1
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEEEEEcCCEEEE-EeCCEEEEEECCCCcEEEEEec
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYSVRCSSRVVAI-CQAAQVHCFDAATLEIEYAILT 262 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~sV~~S~riLAV-a~d~~I~IwDl~T~~~l~tL~t 262 (921)
++..+||..+-+.+.++.++..=+.+...++.|.+ -...+|+.+|..+++...++..
T Consensus 110 ~~~f~yd~~tl~~~~~~~y~~EGWGLt~dg~~Li~SDGS~~L~~~dP~~f~~~~~i~V 167 (264)
T PF05096_consen 110 GTGFVYDPNTLKKIGTFPYPGEGWGLTSDGKRLIMSDGSSRLYFLDPETFKEVRTIQV 167 (264)
T ss_dssp SEEEEEETTTTEEEEEEE-SSS--EEEECSSCEEEE-SSSEEEEE-TTT-SEEEEEE-
T ss_pred CeEEEEccccceEEEEEecCCcceEEEcCCCEEEEECCccceEEECCcccceEEEEEE
Confidence 78899999999999999999888999987665555 4567999999999998887753
No 409
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=39.64 E-value=52 Score=35.33 Aligned_cols=38 Identities=13% Similarity=0.233 Sum_probs=30.2
Q ss_pred EEEeCCCCEEEEEEcCCEE-EEEeCCEEEEEECCCCcEE
Q 002446 220 HMLKFRSPIYSVRCSSRVV-AICQAAQVHCFDAATLEIE 257 (921)
Q Consensus 220 ~tL~f~s~V~sV~~S~riL-AVa~d~~I~IwDl~T~~~l 257 (921)
-.|...++|.-+.+++++| |+...+.+++||+.+++..
T Consensus 7 P~i~Lgs~~~~l~~~~~~Ll~iT~~G~l~vWnl~~~k~~ 45 (219)
T PF07569_consen 7 PPIVLGSPVSFLECNGSYLLAITSSGLLYVWNLKKGKAV 45 (219)
T ss_pred CcEecCCceEEEEeCCCEEEEEeCCCeEEEEECCCCeec
Confidence 4566778888899987655 5588999999999998754
No 410
>PF10214 Rrn6: RNA polymerase I-specific transcription-initiation factor; InterPro: IPR019350 RNA polymerase I-specific transcription-initiation factor Rrn6 and Rrn7 represent components of a multisubunit transcription factor essential for the initiation of rDNA transcription by Pol I []. These proteins are found in fungi.
Probab=39.25 E-value=1.4e+02 Score=38.15 Aligned_cols=84 Identities=19% Similarity=0.235 Sum_probs=53.0
Q ss_pred CCeEEEEECC-CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc------ccccEEEEEEccCCCE
Q 002446 411 SPISALCFDP-SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL------TNAVIQDISFSDDSNW 483 (921)
Q Consensus 411 ~pIsaLaFSP-dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~------t~a~I~sIaFSPDg~~ 483 (921)
.+...++|+| +-+.||..+..|+ ..||++......... ...+.....|. .......|.|.++-..
T Consensus 146 ~~~aDv~FnP~~~~q~AiVD~~G~-Wsvw~i~~~~~~~~~-------~~~~~~~~~gsi~~d~~e~s~w~rI~W~~~~~~ 217 (765)
T PF10214_consen 146 FPHADVAFNPWDQRQFAIVDEKGN-WSVWDIKGRPKRKSS-------NLRLSRNISGSIIFDPEELSNWKRILWVSDSNR 217 (765)
T ss_pred CccceEEeccCccceEEEEeccCc-EEEEEeccccccCCc-------ceeeccCCCccccCCCcccCcceeeEecCCCCE
Confidence 4788999999 5678999999997 899999321110000 00100001111 0112457899999888
Q ss_pred EEEEeCCCcEEEEecCCCCC
Q 002446 484 IMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 484 LAsgS~DgTVhVWdi~~~g~ 503 (921)
|.+.+ +..+.++|+.+...
T Consensus 218 lLv~~-r~~l~~~d~~~~~~ 236 (765)
T PF10214_consen 218 LLVCN-RSKLMLIDFESNWQ 236 (765)
T ss_pred EEEEc-CCceEEEECCCCCc
Confidence 88876 55789999986543
No 411
>PF10647 Gmad1: Lipoprotein LpqB beta-propeller domain; InterPro: IPR018910 The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues.
Probab=38.31 E-value=1.6e+02 Score=32.13 Aligned_cols=67 Identities=12% Similarity=0.127 Sum_probs=46.2
Q ss_pred CeEEEEECCCCCEEEEEe--cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeC
Q 002446 412 PISALCFDPSGILLVTAS--VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSS 489 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS--~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~ 489 (921)
.+.+.+.|+||+.+|... .++..+.++..... ...+. .|. .+..-+|++++...+....
T Consensus 25 ~~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~~~~-------------~~~~~---~g~---~l~~PS~d~~g~~W~v~~~ 85 (253)
T PF10647_consen 25 DVTSPAVSPDGSRVAAVSEGDGGRSLYVGPAGGP-------------VRPVL---TGG---SLTRPSWDPDGWVWTVDDG 85 (253)
T ss_pred cccceEECCCCCeEEEEEEcCCCCEEEEEcCCCc-------------ceeec---cCC---ccccccccCCCCEEEEEcC
Confidence 688899999999988877 67665666654332 11111 222 3778899999887777777
Q ss_pred CCcEEEEe
Q 002446 490 RGTSHLFA 497 (921)
Q Consensus 490 DgTVhVWd 497 (921)
+...+++.
T Consensus 86 ~~~~~~~~ 93 (253)
T PF10647_consen 86 SGGVRVVR 93 (253)
T ss_pred CCceEEEE
Confidence 77777775
No 412
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=37.74 E-value=2e+02 Score=32.65 Aligned_cols=89 Identities=17% Similarity=0.125 Sum_probs=40.9
Q ss_pred CCEEE-EEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 389 VGMVI-VRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 389 ~G~V~-IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.|.+. -||--...=..+-+.-...|.+|.|+|||.+.+.+ ..|. |+.=+.... . ..........-.
T Consensus 164 ~G~~~~s~~~G~~~w~~~~r~~~~riq~~gf~~~~~lw~~~-~Gg~-~~~s~~~~~--~---------~~w~~~~~~~~~ 230 (302)
T PF14870_consen 164 RGNFYSSWDPGQTTWQPHNRNSSRRIQSMGFSPDGNLWMLA-RGGQ-IQFSDDPDD--G---------ETWSEPIIPIKT 230 (302)
T ss_dssp TSSEEEEE-TT-SS-EEEE--SSS-EEEEEE-TTS-EEEEE-TTTE-EEEEE-TTE--E---------EEE---B-TTSS
T ss_pred cccEEEEecCCCccceEEccCccceehhceecCCCCEEEEe-CCcE-EEEccCCCC--c---------cccccccCCccc
Confidence 34443 35543322223334456789999999999987765 5553 544431111 0 000000000001
Q ss_pred ccccEEEEEEccCCCEEEEEeCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
...-|.+++|.+++...|+|+..
T Consensus 231 ~~~~~ld~a~~~~~~~wa~gg~G 253 (302)
T PF14870_consen 231 NGYGILDLAYRPPNEIWAVGGSG 253 (302)
T ss_dssp --S-EEEEEESSSS-EEEEESTT
T ss_pred CceeeEEEEecCCCCEEEEeCCc
Confidence 11238999999999988877654
No 413
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=37.46 E-value=88 Score=34.36 Aligned_cols=89 Identities=19% Similarity=0.197 Sum_probs=50.6
Q ss_pred EEEEEECCCCceEEEec-cCCCCeEEEEECCCCCEEEEEecCC--CEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccc
Q 002446 391 MVIVRDIVSKNVIAQFR-AHKSPISALCFDPSGILLVTASVQG--HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGL 467 (921)
Q Consensus 391 ~V~IwDl~s~~~l~~~~-aH~~pIsaLaFSPdGtlLATaS~DG--t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~ 467 (921)
.-.+||+.+++.. .+. ....-++.=+|-|||++|.+++... +.||+|+.... ...++|......+ ...|=.
T Consensus 47 ~s~~yD~~tn~~r-pl~v~td~FCSgg~~L~dG~ll~tGG~~~G~~~ir~~~p~~~----~~~~~w~e~~~~m-~~~RWY 120 (243)
T PF07250_consen 47 HSVEYDPNTNTFR-PLTVQTDTFCSGGAFLPDGRLLQTGGDNDGNKAIRIFTPCTS----DGTCDWTESPNDM-QSGRWY 120 (243)
T ss_pred EEEEEecCCCcEE-eccCCCCCcccCcCCCCCCCEEEeCCCCccccceEEEecCCC----CCCCCceECcccc-cCCCcc
Confidence 4568999988653 333 2333455567899999999987632 35889886541 0111221111111 111212
Q ss_pred ccccEEEEEEccCCCEEEEEeCC
Q 002446 468 TNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 468 t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
-+..-=|||+.|++|+.+
T Consensus 121 -----pT~~~L~DG~vlIvGG~~ 138 (243)
T PF07250_consen 121 -----PTATTLPDGRVLIVGGSN 138 (243)
T ss_pred -----ccceECCCCCEEEEeCcC
Confidence 123345899999999887
No 414
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=37.41 E-value=1.1e+03 Score=31.09 Aligned_cols=72 Identities=13% Similarity=0.196 Sum_probs=42.9
Q ss_pred EEeccCCCCeEEEEECCCCCEEEEEecCC-------------CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccc
Q 002446 404 AQFRAHKSPISALCFDPSGILLVTASVQG-------------HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNA 470 (921)
Q Consensus 404 ~~~~aH~~pIsaLaFSPdGtlLATaS~DG-------------t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a 470 (921)
.++.-|. +...++|.+.-.++++.+... +.++++|-.+. ...+.+++.+-.+.-
T Consensus 709 rtvpl~~-~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf------------~vl~~hef~~~E~~~ 775 (1096)
T KOG1897|consen 709 RTVPLGE-SPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTF------------EVLSSHEFERNETAL 775 (1096)
T ss_pred eeecCCC-ChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCce------------eEEeeccccccceee
Confidence 3444443 456778888666666665432 23566665543 234445555444434
Q ss_pred cEEEEEEccC-CCEEEEEe
Q 002446 471 VIQDISFSDD-SNWIMISS 488 (921)
Q Consensus 471 ~I~sIaFSPD-g~~LAsgS 488 (921)
.|.++.|..| ++++++|+
T Consensus 776 Si~s~~~~~d~~t~~vVGT 794 (1096)
T KOG1897|consen 776 SIISCKFTDDPNTYYVVGT 794 (1096)
T ss_pred eeeeeeecCCCceEEEEEE
Confidence 4777779888 88999985
No 415
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=37.10 E-value=12 Score=47.28 Aligned_cols=98 Identities=19% Similarity=0.222 Sum_probs=57.2
Q ss_pred CCCEEEEEECC--CCceEEEec-----cCCCCeE---EEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCce
Q 002446 388 NVGMVIVRDIV--SKNVIAQFR-----AHKSPIS---ALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSY 457 (921)
Q Consensus 388 ~~G~V~IwDl~--s~~~l~~~~-----aH~~pIs---aLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~ 457 (921)
..|...|||++ .|++...+. .-..++. -.-|-++--++..+..+|+ |++..+... .
T Consensus 151 ~vg~lfVy~vd~l~G~iq~~l~v~~~~p~gs~~~~V~wcp~~~~~~~ic~~~~~~~-i~lL~~~ra-------------~ 216 (1283)
T KOG1916|consen 151 LVGELFVYDVDVLQGEIQPQLEVTPITPYGSDPQLVSWCPIAVNKVYICYGLKGGE-IRLLNINRA-------------L 216 (1283)
T ss_pred HhhhhheeehHhhccccccceEEeecCcCCCCcceeeecccccccceeeeccCCCc-eeEeeechH-------------H
Confidence 35778889875 344333332 2223333 3344455656666666665 787776653 0
Q ss_pred eEEEEEecccccccEEEE-----------EEccCCCEEEEEeCCCcEEEEecCCCCC
Q 002446 458 VHLYRLQRGLTNAVIQDI-----------SFSDDSNWIMISSSRGTSHLFAINPLGG 503 (921)
Q Consensus 458 ~~l~~l~RG~t~a~I~sI-----------aFSPDg~~LAsgS~DgTVhVWdi~~~g~ 503 (921)
..+.|+|... +.++ ..||||+.||.++.||.++.|.+.-.|.
T Consensus 217 ---~~l~rsHs~~-~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG~v~f~Qiyi~g~ 269 (1283)
T KOG1916|consen 217 ---RSLFRSHSQR-VTDMAFFAEGVLKLASLSPDGTVFAWAISDGSVGFYQIYITGK 269 (1283)
T ss_pred ---HHHHHhcCCC-cccHHHHhhchhhheeeCCCCcEEEEeecCCccceeeeeeecc
Confidence 1333443222 2222 2699999999999999999887754433
No 416
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=36.87 E-value=1.7e+02 Score=33.18 Aligned_cols=75 Identities=17% Similarity=0.339 Sum_probs=46.8
Q ss_pred EEEEECCCCceEE--------EeccCCCCeEEEEECCCCCEEEEEecCC----CEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 392 VIVRDIVSKNVIA--------QFRAHKSPISALCFDPSGILLVTASVQG----HNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 392 V~IwDl~s~~~l~--------~~~aH~~pIsaLaFSPdGtlLATaS~DG----t~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
..++|....+.+. +|-+|. .|||||.+|...-.|- -+|-|||...+ ..+
T Consensus 93 ~~vfD~~~~~~pv~~~s~~~RHfyGHG------vfs~dG~~LYATEndfd~~rGViGvYd~r~~-------------fqr 153 (366)
T COG3490 93 AMVFDPNGAQEPVTLVSQEGRHFYGHG------VFSPDGRLLYATENDFDPNRGVIGVYDAREG-------------FQR 153 (366)
T ss_pred EEEECCCCCcCcEEEecccCceeeccc------ccCCCCcEEEeecCCCCCCCceEEEEecccc-------------cce
Confidence 4557776655443 344553 7999999987654331 15889988764 122
Q ss_pred EEEEe-cccccccEEEEEEccCCCEEEEEe
Q 002446 460 LYRLQ-RGLTNAVIQDISFSDDSNWIMISS 488 (921)
Q Consensus 460 l~~l~-RG~t~a~I~sIaFSPDg~~LAsgS 488 (921)
+-++. .|.- -.++.|.+||+.++++.
T Consensus 154 vgE~~t~GiG---pHev~lm~DGrtlvvan 180 (366)
T COG3490 154 VGEFSTHGIG---PHEVTLMADGRTLVVAN 180 (366)
T ss_pred ecccccCCcC---cceeEEecCCcEEEEeC
Confidence 22221 1222 34788999999999875
No 417
>PF01011 PQQ: PQQ enzyme repeat family.; InterPro: IPR002372 Pyrrolo-quinoline quinone (PQQ) is a redox coenzyme, which serves as a cofactor for a number of enzymes (quinoproteins) and particularly for some bacterial dehydrogenases [, ]. A number of bacterial quinoproteins belong to this family. Enzymes in this group have repeats of a beta propeller.; PDB: 1H4I_C 1H4J_E 1W6S_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A 1G72_A ....
Probab=36.55 E-value=64 Score=24.64 Aligned_cols=27 Identities=19% Similarity=0.127 Sum_probs=22.2
Q ss_pred EEEEEeCCEEEEEECCCCcEEEEEecC
Q 002446 237 VVAICQAAQVHCFDAATLEIEYAILTN 263 (921)
Q Consensus 237 iLAVa~d~~I~IwDl~T~~~l~tL~t~ 263 (921)
+.+...++.|+.+|+.|++.++.....
T Consensus 3 v~~~~~~g~l~AlD~~TG~~~W~~~~~ 29 (38)
T PF01011_consen 3 VYVGTPDGYLYALDAKTGKVLWKFQTG 29 (38)
T ss_dssp EEEETTTSEEEEEETTTTSEEEEEESS
T ss_pred EEEeCCCCEEEEEECCCCCEEEeeeCC
Confidence 344467889999999999999998764
No 418
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=36.38 E-value=4.6e+02 Score=28.86 Aligned_cols=106 Identities=12% Similarity=0.262 Sum_probs=61.8
Q ss_pred ccCCCCEEEEEECCCCceEEEeccC-CCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEE
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAH-KSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRL 463 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH-~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l 463 (921)
-.+.++.|..+|.. |+++..+.-. .+-.-.|++--+|+++++.-.+++ +.++++..... . ........+
T Consensus 39 V~d~~~~i~els~~-G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~-L~~~~~~~~~~-~-------~~~~~~~~~ 108 (248)
T PF06977_consen 39 VQDEPGEIYELSLD-GKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQR-LYIFTIDDDTT-S-------LDRADVQKI 108 (248)
T ss_dssp EETTTTEEEEEETT---EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTE-EEEEEE----T-T---------EEEEEEE
T ss_pred EECCCCEEEEEcCC-CCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCc-EEEEEEecccc-c-------cchhhceEE
Confidence 34567889889974 7788877633 245778889888887776555665 78888854310 0 011122222
Q ss_pred ecccc---cccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 464 QRGLT---NAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 464 ~RG~t---~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
.-+.. +.-+-.|||.|.++.|.++-.+....||.+..
T Consensus 109 ~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~ 148 (248)
T PF06977_consen 109 SLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNG 148 (248)
T ss_dssp E---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEES
T ss_pred ecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEcc
Confidence 22222 22288999999988888887877777777654
No 419
>smart00036 CNH Domain found in NIK1-like kinases, mouse citron and yeast ROM1, ROM2. Unpublished observations.
Probab=36.37 E-value=3.5e+02 Score=30.35 Aligned_cols=38 Identities=24% Similarity=0.476 Sum_probs=30.0
Q ss_pred eEEEEEccCcEEEEEccCC-CCeEEeeeeecCCEEEEEEec
Q 002446 108 RVLLLGYRSGFQVWDVEEA-DNVHDLVSRYDGPVSFMQMLP 147 (921)
Q Consensus 108 ~vLllG~~~GfqVWDv~~~-~~~~elvS~~dG~Vr~v~~lP 147 (921)
+.|++|++.|+-+.|+... +....+++++ +|..+.+++
T Consensus 14 ~~lL~GTe~Gly~~~~~~~~~~~~kl~~~~--~v~q~~v~~ 52 (302)
T smart00036 14 KWLLVGTEEGLYVLNISDQPGTLEKLIGRR--SVTQIWVLE 52 (302)
T ss_pred cEEEEEeCCceEEEEcccCCCCeEEecCcC--ceEEEEEEh
Confidence 5799999999999998753 3566666654 889999986
No 420
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=35.89 E-value=1.1e+02 Score=36.78 Aligned_cols=20 Identities=35% Similarity=0.504 Sum_probs=15.4
Q ss_pred eEEEEECCCCCEEEEEecCC
Q 002446 413 ISALCFDPSGILLVTASVQG 432 (921)
Q Consensus 413 IsaLaFSPdGtlLATaS~DG 432 (921)
-..|+|.|||+++++.++.|
T Consensus 148 GgrI~FgPDG~LYVs~GD~g 167 (454)
T TIGR03606 148 GGRLVFGPDGKIYYTIGEQG 167 (454)
T ss_pred CceEEECCCCcEEEEECCCC
Confidence 35688999999888776654
No 421
>PF04841 Vps16_N: Vps16, N-terminal region; InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=35.52 E-value=2.2e+02 Score=33.52 Aligned_cols=29 Identities=21% Similarity=0.497 Sum_probs=23.5
Q ss_pred ccEEEEEEccCCCEEEEEeCCCcEEEEecC
Q 002446 470 AVIQDISFSDDSNWIMISSSRGTSHLFAIN 499 (921)
Q Consensus 470 a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~ 499 (921)
..|.++.|+.+.+ |++...||++++|++.
T Consensus 81 ~~iv~~~wt~~e~-LvvV~~dG~v~vy~~~ 109 (410)
T PF04841_consen 81 GRIVGMGWTDDEE-LVVVQSDGTVRVYDLF 109 (410)
T ss_pred CCEEEEEECCCCe-EEEEEcCCEEEEEeCC
Confidence 4699999998655 5566789999999985
No 422
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=35.37 E-value=13 Score=45.31 Aligned_cols=107 Identities=15% Similarity=0.237 Sum_probs=67.4
Q ss_pred CCCEEEEEECCCC--c--eEEEecc-CCCCeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEE
Q 002446 388 NVGMVIVRDIVSK--N--VIAQFRA-HKSPISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYR 462 (921)
Q Consensus 388 ~~G~V~IwDl~s~--~--~l~~~~a-H~~pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~ 462 (921)
.+-.+.|||+.++ . .-..|.+ -......+|+-.|-+++.+|.... .++|||+...+.. +..+.
T Consensus 127 nds~~~Iwdi~s~ltvPke~~~fs~~~l~gqns~cwlrd~klvlaGm~sr-~~~ifdlRqs~~~----------~~svn- 194 (783)
T KOG1008|consen 127 NDSSLKIWDINSLLTVPKESPLFSSSTLDGQNSVCWLRDTKLVLAGMTSR-SVHIFDLRQSLDS----------VSSVN- 194 (783)
T ss_pred ccCCccceecccccCCCccccccccccccCccccccccCcchhhcccccc-hhhhhhhhhhhhh----------hhhhh-
Confidence 3456899999876 2 2233433 334566889998999988888774 5999999853110 11111
Q ss_pred EecccccccEEEEEEcc-CCCEEEEEeCCCcEEEEec-CCCCCceeecCCCCC
Q 002446 463 LQRGLTNAVIQDISFSD-DSNWIMISSSRGTSHLFAI-NPLGGSVNFQPTDAN 513 (921)
Q Consensus 463 l~RG~t~a~I~sIaFSP-Dg~~LAsgS~DgTVhVWdi-~~~g~~~~l~~H~~~ 513 (921)
|. -++.+..+| ...|+|+-+ ||-|-+||. .....+...-.|..+
T Consensus 195 -----Tk-~vqG~tVdp~~~nY~cs~~-dg~iAiwD~~rnienpl~~i~~~~N 240 (783)
T KOG1008|consen 195 -----TK-YVQGITVDPFSPNYFCSNS-DGDIAIWDTYRNIENPLQIILRNEN 240 (783)
T ss_pred -----hh-hcccceecCCCCCceeccc-cCceeeccchhhhccHHHHHhhCCC
Confidence 11 266778888 788998877 999999993 333333333344443
No 423
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=35.28 E-value=13 Score=45.45 Aligned_cols=102 Identities=10% Similarity=0.159 Sum_probs=66.1
Q ss_pred CCCCEEEEEECCCCce--EEEeccCCCCeEEEEECC-CCCEEEEEecCC----CEEEEEeCCCCCCCCCCccCCCCceeE
Q 002446 387 DNVGMVIVRDIVSKNV--IAQFRAHKSPISALCFDP-SGILLVTASVQG----HNINIFKIIPGILGTSSACDAGTSYVH 459 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~--l~~~~aH~~pIsaLaFSP-dGtlLATaS~DG----t~IrIWdi~~g~~~~~s~~~~~~~~~~ 459 (921)
...|.|-+-.+....- -....+|..++++++|++ |-..||.+ -|. +.+.|||+......+ ..
T Consensus 77 ~atG~I~l~s~r~~hdSs~E~tp~~ar~Ct~lAwneLDtn~LAag-ldkhrnds~~~Iwdi~s~ltvP----------ke 145 (783)
T KOG1008|consen 77 SATGNISLLSVRHPHDSSAEVTPGYARPCTSLAWNELDTNHLAAG-LDKHRNDSSLKIWDINSLLTVP----------KE 145 (783)
T ss_pred cccCceEEeecCCcccccceecccccccccccccccccHHHHHhh-hhhhcccCCccceecccccCCC----------cc
Confidence 3447777766554322 234568889999999999 45566655 332 348999998752110 00
Q ss_pred EEEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCC
Q 002446 460 LYRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINP 500 (921)
Q Consensus 460 l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~ 500 (921)
-..+..+ +.....++||-.|-+.|.+|.....+|+||+.-
T Consensus 146 ~~~fs~~-~l~gqns~cwlrd~klvlaGm~sr~~~ifdlRq 185 (783)
T KOG1008|consen 146 SPLFSSS-TLDGQNSVCWLRDTKLVLAGMTSRSVHIFDLRQ 185 (783)
T ss_pred ccccccc-cccCccccccccCcchhhcccccchhhhhhhhh
Confidence 1111111 111255899999999999999999999999973
No 424
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=34.81 E-value=27 Score=44.31 Aligned_cols=106 Identities=14% Similarity=0.274 Sum_probs=58.9
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEE-----------ECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCC
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALC-----------FDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGT 455 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLa-----------FSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~ 455 (921)
..+|.|++..+..-. ...|+.|...+..++ .||||+.+|+++.||. ++.|.+.-. |. -..
T Consensus 202 ~~~~~i~lL~~~ra~-~~l~rsHs~~~~d~a~~~~g~~~l~~lSpDGtv~a~a~~dG~-v~f~Qiyi~--g~-----~~~ 272 (1283)
T KOG1916|consen 202 LKGGEIRLLNINRAL-RSLFRSHSQRVTDMAFFAEGVLKLASLSPDGTVFAWAISDGS-VGFYQIYIT--GK-----IVH 272 (1283)
T ss_pred cCCCceeEeeechHH-HHHHHhcCCCcccHHHHhhchhhheeeCCCCcEEEEeecCCc-cceeeeeee--cc-----ccH
Confidence 345667765443321 255667876666554 5999999999999996 777776432 00 001
Q ss_pred ceeEEEEEecccccccEEEEEEccC-------CCE--EEEEeCCC-cEEEEecCCCCCc
Q 002446 456 SYVHLYRLQRGLTNAVIQDISFSDD-------SNW--IMISSSRG-TSHLFAINPLGGS 504 (921)
Q Consensus 456 ~~~~l~~l~RG~t~a~I~sIaFSPD-------g~~--LAsgS~Dg-TVhVWdi~~~g~~ 504 (921)
.+.|.++-+-++ -+|..+ |... ++| +.++++-+ -+++|.-.+..+.
T Consensus 273 rclhewkphd~~--p~vC~l-c~~~~~~~v~i~~w~~~Itttd~nre~k~w~~a~w~Cl 328 (1283)
T KOG1916|consen 273 RCLHEWKPHDKH--PRVCWL-CHKQEILVVSIGKWVLRITTTDVNREEKFWAEAPWQCL 328 (1283)
T ss_pred hhhhccCCCCCC--Cceeee-eccccccCCccceeEEEEecccCCcceeEeeccchhhh
Confidence 223333332221 123222 2211 233 45555544 5899998887777
No 425
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=32.35 E-value=7.4e+02 Score=27.64 Aligned_cols=54 Identities=15% Similarity=0.322 Sum_probs=38.9
Q ss_pred CEEEEEECCCCceEEEec--cC----CCCeEEEEECCC-C----CEEEEEecCCCEEEEEeCCCC
Q 002446 390 GMVIVRDIVSKNVIAQFR--AH----KSPISALCFDPS-G----ILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 390 G~V~IwDl~s~~~l~~~~--aH----~~pIsaLaFSPd-G----tlLATaS~DGt~IrIWdi~~g 443 (921)
-++.+||+.+.++++++. .+ .+-+..|+++.. + .+.-.++..+.-|-|+|+.++
T Consensus 34 pKLv~~Dl~t~~li~~~~~p~~~~~~~s~lndl~VD~~~~~~~~~~aYItD~~~~glIV~dl~~~ 98 (287)
T PF03022_consen 34 PKLVAFDLKTNQLIRRYPFPPDIAPPDSFLNDLVVDVRDGNCDDGFAYITDSGGPGLIVYDLATG 98 (287)
T ss_dssp -EEEEEETTTTCEEEEEE--CCCS-TCGGEEEEEEECTTTTS-SEEEEEEETTTCEEEEEETTTT
T ss_pred cEEEEEECCCCcEEEEEECChHHcccccccceEEEEccCCCCcceEEEEeCCCcCcEEEEEccCC
Confidence 478999999999988776 21 356888888883 2 355555555456899999986
No 426
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=30.29 E-value=8.2e+02 Score=27.40 Aligned_cols=56 Identities=7% Similarity=0.156 Sum_probs=40.8
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEEE--EEE-cCCEEEEE-eCCEEEEEECCCCcEEEEEe
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIYS--VRC-SSRVVAIC-QAAQVHCFDAATLEIEYAIL 261 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~s--V~~-S~riLAVa-~d~~I~IwDl~T~~~l~tL~ 261 (921)
..|+.+|+.||+......++....+ |.. +.++.... .++...+||..|++.+.++.
T Consensus 68 S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~~d~l~qLTWk~~~~f~yd~~tl~~~~~~~ 127 (264)
T PF05096_consen 68 SSLRKVDLETGKVLQSVPLPPRYFGEGITILGDKLYQLTWKEGTGFVYDPNTLKKIGTFP 127 (264)
T ss_dssp EEEEEEETTTSSEEEEEE-TTT--EEEEEEETTEEEEEESSSSEEEEEETTTTEEEEEEE
T ss_pred EEEEEEECCCCcEEEEEECCccccceeEEEECCEEEEEEecCCeEEEEccccceEEEEEe
Confidence 6799999999999999998876543 333 34544444 56799999999999887763
No 427
>smart00564 PQQ beta-propeller repeat. Beta-propeller repeat occurring in enzymes with pyrrolo-quinoline quinone (PQQ) as cofactor, in Ire1p-like Ser/Thr kinases, and in prokaryotic dehydrogenases.
Probab=29.26 E-value=1.2e+02 Score=21.79 Aligned_cols=25 Identities=24% Similarity=0.184 Sum_probs=19.8
Q ss_pred CEEEEEeCCEEEEEECCCCcEEEEE
Q 002446 236 RVVAICQAAQVHCFDAATLEIEYAI 260 (921)
Q Consensus 236 riLAVa~d~~I~IwDl~T~~~l~tL 260 (921)
.+++...++.++.+|+.+++.+++.
T Consensus 8 ~v~~~~~~g~l~a~d~~~G~~~W~~ 32 (33)
T smart00564 8 TVYVGSTDGTLYALDAKTGEILWTY 32 (33)
T ss_pred EEEEEcCCCEEEEEEcccCcEEEEc
Confidence 4555577899999999999987763
No 428
>COG3211 PhoX Predicted phosphatase [General function prediction only]
Probab=27.76 E-value=1.3e+02 Score=36.74 Aligned_cols=65 Identities=18% Similarity=0.289 Sum_probs=39.0
Q ss_pred eEEEEECCCCCEEEEEecCC-----CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEE
Q 002446 413 ISALCFDPSGILLVTASVQG-----HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMIS 487 (921)
Q Consensus 413 IsaLaFSPdGtlLATaS~DG-----t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsg 487 (921)
.-.|+|+|.|++.+..+..+ +..=+|.+.+. ......+..+.++-..+.+...+||||++-|.++
T Consensus 502 PDnl~fD~~GrLWi~TDg~~s~~~~~~~G~~~m~~~----------~p~~g~~~rf~t~P~g~E~tG~~FspD~~TlFV~ 571 (616)
T COG3211 502 PDNLAFDPWGRLWIQTDGSGSTLRNRFRGVTQMLTP----------DPKTGTIKRFLTGPIGCEFTGPCFSPDGKTLFVN 571 (616)
T ss_pred CCceEECCCCCEEEEecCCCCccCcccccccccccC----------CCccceeeeeccCCCcceeecceeCCCCceEEEE
Confidence 34589999999887644322 11223322221 0112344555566666779999999999877654
No 429
>TIGR03074 PQQ_membr_DH membrane-bound PQQ-dependent dehydrogenase, glucose/quinate/shikimate family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Members of this family have several predicted transmembrane helices in the N-terminal region, and include the quinoprotein glucose dehydrogenase (EC 1.1.5.2) of Escherichia coli and the quinate/shikimate dehydrogenase of Acinetobacter sp. ADP1 (EC 1.1.99.25). Sequences closely related except for the absense of the N-terminal hydrophobic region, scoring in the gray zone between the trusted and noise cutoffs, include PQQ-dependent glycerol (EC 1.1.99.22) and and other polyol (sugar alcohol) dehydrogenases.
Probab=27.24 E-value=1.4e+03 Score=29.30 Aligned_cols=56 Identities=14% Similarity=0.084 Sum_probs=37.5
Q ss_pred cEEEEEECCCCcEEEEEeCCCCEE---------EE-------------------EEcCCEEEEEeCCEEEEEECCCCcEE
Q 002446 206 TVVHFYSLRSQSYVHMLKFRSPIY---------SV-------------------RCSSRVVAICQAAQVHCFDAATLEIE 257 (921)
Q Consensus 206 ~tVrIWDL~Tg~~V~tL~f~s~V~---------sV-------------------~~S~riLAVa~d~~I~IwDl~T~~~l 257 (921)
+.|.=.|.+||+.+-.+.....+. .+ .|..++++.+.|++++..|+.|++.+
T Consensus 204 ~~V~ALDa~TGk~lW~~d~~~~~~~~~~~~~cRGvay~~~p~~~~~~~~~~~p~~~~~rV~~~T~Dg~LiALDA~TGk~~ 283 (764)
T TIGR03074 204 NKVIALDAATGKEKWKFDPKLKTEAGRQHQTCRGVSYYDAPAAAAGPAAPAAPADCARRIILPTSDARLIALDADTGKLC 283 (764)
T ss_pred CeEEEEECCCCcEEEEEcCCCCcccccccccccceEEecCCcccccccccccccccCCEEEEecCCCeEEEEECCCCCEE
Confidence 456666888888777765533221 11 12235666678999999999999988
Q ss_pred EEEe
Q 002446 258 YAIL 261 (921)
Q Consensus 258 ~tL~ 261 (921)
..+.
T Consensus 284 W~fg 287 (764)
T TIGR03074 284 EDFG 287 (764)
T ss_pred EEec
Confidence 7754
No 430
>PF13570 PQQ_3: PQQ-like domain; PDB: 3HXJ_B 3Q54_A.
Probab=26.90 E-value=1.4e+02 Score=22.80 Aligned_cols=22 Identities=27% Similarity=0.259 Sum_probs=14.7
Q ss_pred EEc-CCEEEEEeCCEEEEEECCC
Q 002446 232 RCS-SRVVAICQAAQVHCFDAAT 253 (921)
Q Consensus 232 ~~S-~riLAVa~d~~I~IwDl~T 253 (921)
.+. +++.+.+.+++++++|+.|
T Consensus 18 ~v~~g~vyv~~~dg~l~ald~~t 40 (40)
T PF13570_consen 18 AVAGGRVYVGTGDGNLYALDAAT 40 (40)
T ss_dssp EECTSEEEEE-TTSEEEEEETT-
T ss_pred EEECCEEEEEcCCCEEEEEeCCC
Confidence 444 4555567889999999875
No 431
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=26.36 E-value=2e+02 Score=31.08 Aligned_cols=58 Identities=14% Similarity=0.386 Sum_probs=37.9
Q ss_pred EEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccCCCEEEEEeCC
Q 002446 416 LCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDDSNWIMISSSR 490 (921)
Q Consensus 416 LaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPDg~~LAsgS~D 490 (921)
++-++.+.+|+++ .|..|.+|++... .+..++++. |-..|..|+++.-|.||++-=.+
T Consensus 23 ~c~~g~d~Lfva~--~g~~Vev~~l~~~------------~~~~~~~F~---Tv~~V~~l~y~~~GDYlvTlE~k 80 (215)
T PF14761_consen 23 VCCGGPDALFVAA--SGCKVEVYDLEQE------------ECPLLCTFS---TVGRVLQLVYSEAGDYLVTLEEK 80 (215)
T ss_pred eeccCCceEEEEc--CCCEEEEEEcccC------------CCceeEEEc---chhheeEEEeccccceEEEEEee
Confidence 3344434444443 3456999999843 234566663 34569999999999999986443
No 432
>PF13449 Phytase-like: Esterase-like activity of phytase
Probab=26.24 E-value=8.3e+02 Score=27.57 Aligned_cols=85 Identities=16% Similarity=0.238 Sum_probs=50.5
Q ss_pred CCCeEEEEECCCCCEEEEEecCC-------------CEEEEEeCCCCCCCCCCccCCCCceeEEEEEecc---cccccEE
Q 002446 410 KSPISALCFDPSGILLVTASVQG-------------HNINIFKIIPGILGTSSACDAGTSYVHLYRLQRG---LTNAVIQ 473 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DG-------------t~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG---~t~a~I~ 473 (921)
+...-+|+++|||+.|.++-... +.+||+.......+. ......|.+..- .....|.
T Consensus 146 N~G~E~la~~~dG~~l~~~~E~~l~~d~~~~~~~~~~~~ri~~~d~~~~~~-------~~~~~~y~ld~~~~~~~~~~is 218 (326)
T PF13449_consen 146 NRGFEGLAVSPDGRTLFAAMESPLKQDGPRANPDNGSPLRILRYDPKTPGE-------PVAEYAYPLDPPPTAPGDNGIS 218 (326)
T ss_pred CCCeEEEEECCCCCEEEEEECccccCCCcccccccCceEEEEEecCCCCCc-------cceEEEEeCCccccccCCCCce
Confidence 45788999999999777664332 125666655431010 012345555420 0234599
Q ss_pred EEEEccCCCEEEEEe-----CCCcEEEEecCCC
Q 002446 474 DISFSDDSNWIMISS-----SRGTSHLFAINPL 501 (921)
Q Consensus 474 sIaFSPDg~~LAsgS-----~DgTVhVWdi~~~ 501 (921)
++++-+|+++|+.== ....++||.+...
T Consensus 219 d~~al~d~~lLvLER~~~~~~~~~~ri~~v~l~ 251 (326)
T PF13449_consen 219 DIAALPDGRLLVLERDFSPGTGNYKRIYRVDLS 251 (326)
T ss_pred eEEEECCCcEEEEEccCCCCccceEEEEEEEcc
Confidence 999999999876532 2456777776543
No 433
>PF01731 Arylesterase: Arylesterase; InterPro: IPR002640 The serum paraoxonases/arylesterases are enzymes that catalyse the hydrolysis of the toxic metabolites of a variety of organophosphorus insecticides. The enzymes hydrolyse a broad spectrum of organophosphate substrates, including paraoxon and a number of aromatic carboxylic acid esters (e.g., phenyl acetate), and hence confer resistance to organophosphate toxicity []. Mammals have 3 distinct paraoxonase types, termed PON1-3 [, ]. In mice and humans, the PON genes are found on the same chromosome in close proximity. PON activity has been found in variety of tissues, with highest levels in liver and serum - the source of serum PON is thought to be the liver. Unlike mammals, fish and avian species lack paraoxonase activity. Human and rabbit PONs appear to have two distinct Ca2+ binding sites, one required for stability and one required for catalytic activity. The Ca2+ dependency of PONs suggests a mechanism of hydrolysis where Ca2+ acts as the electrophillic catalyst, like that proposed for phospholipase A2. The paraoxonase enzymes, PON1 and PON3, are high density lipoprotein (HDL)- associated proteins capable of preventing oxidative modification of low density lipoproteins (LPL) []. Although PON2 has oxidative properties, the enzyme does not associate with HDL. Within a given species, PON1, PON2 and PON3 share ~60% amino acid sequence identity, whereas between mammalian species particular PONs (1,2 or 3) share 79-90% identity at the amino acid level. Human PON1 and PON3 share numerous conserved phosphorylation and N-glycosylation sites; however, it is not known whether the PON proteins are modified at these sites, or whether modification at these sites is required for activity in vivo []. This family consists of arylesterases (Also known as serum paraoxonase) 3.1.1.2 from EC. These enzymes hydrolyse organophosphorus esters such as paraoxon and are found in the liver and blood. They confer resistance to organophosphate toxicity []. Human arylesterase (PON1) P27169 from SWISSPROT is associated with HDL and may protect against LDL oxidation [].; GO: 0004064 arylesterase activity
Probab=25.85 E-value=1e+02 Score=28.57 Aligned_cols=29 Identities=17% Similarity=0.376 Sum_probs=23.6
Q ss_pred EEEEEEccCCCEEEEEe-CCCcEEEEecCC
Q 002446 472 IQDISFSDDSNWIMISS-SRGTSHLFAINP 500 (921)
Q Consensus 472 I~sIaFSPDg~~LAsgS-~DgTVhVWdi~~ 500 (921)
-..|++|||+++|.+++ .+++||||..++
T Consensus 56 aNGI~~s~~~k~lyVa~~~~~~I~vy~~~~ 85 (86)
T PF01731_consen 56 ANGIAISPDKKYLYVASSLAHSIHVYKRHK 85 (86)
T ss_pred CceEEEcCCCCEEEEEeccCCeEEEEEecC
Confidence 36899999999987765 478999998754
No 434
>COG2133 Glucose/sorbosone dehydrogenases [Carbohydrate transport and metabolism]
Probab=25.23 E-value=2.2e+02 Score=33.60 Aligned_cols=20 Identities=35% Similarity=0.431 Sum_probs=16.5
Q ss_pred CeEEEEECCCCCEEEEEecC
Q 002446 412 PISALCFDPSGILLVTASVQ 431 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~D 431 (921)
.=..|.|+|||+|.++.++.
T Consensus 178 ~g~~l~f~pDG~Lyvs~G~~ 197 (399)
T COG2133 178 FGGRLVFGPDGKLYVTTGSN 197 (399)
T ss_pred CcccEEECCCCcEEEEeCCC
Confidence 44679999999999987765
No 435
>PF05694 SBP56: 56kDa selenium binding protein (SBP56); InterPro: IPR008826 This family consists of several eukaryotic selenium binding proteins as well as three sequences from archaea. The exact function of this protein is unknown although it is thought that SBP56 participates in late stages of intra-Golgi protein transport []. The Lotus japonicus homologue of SBP56, LjSBP is thought to have more than one physiological role and can be implicated in controlling the oxidation/reduction status of target proteins in vesicular Golgi transport [].; GO: 0008430 selenium binding; PDB: 2ECE_A.
Probab=24.63 E-value=1.3e+02 Score=35.87 Aligned_cols=47 Identities=11% Similarity=0.191 Sum_probs=33.2
Q ss_pred CcEEEEEECCCCcEEEEEeCCC---CEEEEEEc--C----CEEEEEeCCEEEEEEC
Q 002446 205 PTVVHFYSLRSQSYVHMLKFRS---PIYSVRCS--S----RVVAICQAAQVHCFDA 251 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f~s---~V~sV~~S--~----riLAVa~d~~I~IwDl 251 (921)
-+++.|||+++++.+++|.+.. -...|+|- + -++.+++..+|..|--
T Consensus 221 G~~l~vWD~~~r~~~Q~idLg~~g~~pLEvRflH~P~~~~gFvg~aLss~i~~~~k 276 (461)
T PF05694_consen 221 GHSLHVWDWSTRKLLQTIDLGEEGQMPLEVRFLHDPDANYGFVGCALSSSIWRFYK 276 (461)
T ss_dssp --EEEEEETTTTEEEEEEES-TTEEEEEEEEE-SSTT--EEEEEEE--EEEEEEEE
T ss_pred cCeEEEEECCCCcEeeEEecCCCCCceEEEEecCCCCccceEEEEeccceEEEEEE
Confidence 4789999999999999999963 56788983 2 3666678888877754
No 436
>PRK10115 protease 2; Provisional
Probab=24.28 E-value=6.2e+02 Score=31.91 Aligned_cols=99 Identities=6% Similarity=0.047 Sum_probs=55.8
Q ss_pred CCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC-C----CEEEEEeCCCCCCCCCCccCCCCceeEEE
Q 002446 387 DNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ-G----HNINIFKIIPGILGTSSACDAGTSYVHLY 461 (921)
Q Consensus 387 ~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D-G----t~IrIWdi~~g~~~~~s~~~~~~~~~~l~ 461 (921)
...-.|+|.|+.++..+...-.... ..++|++||+.|+-...+ + ..|..+++.++. ..-..++
T Consensus 150 ~E~~~l~v~d~~tg~~l~~~i~~~~--~~~~w~~D~~~~~y~~~~~~~~~~~~v~~h~lgt~~----------~~d~lv~ 217 (686)
T PRK10115 150 RRQYGIRFRNLETGNWYPELLDNVE--PSFVWANDSWTFYYVRKHPVTLLPYQVWRHTIGTPA----------SQDELVY 217 (686)
T ss_pred cEEEEEEEEECCCCCCCCccccCcc--eEEEEeeCCCEEEEEEecCCCCCCCEEEEEECCCCh----------hHCeEEE
Confidence 3446799999998864322222222 459999999876665543 2 245556666530 0123444
Q ss_pred EEecccccccEEEEEEccCCCEEEEEeCCC---cEEEEecCC
Q 002446 462 RLQRGLTNAVIQDISFSDDSNWIMISSSRG---TSHLFAINP 500 (921)
Q Consensus 462 ~l~RG~t~a~I~sIaFSPDg~~LAsgS~Dg---TVhVWdi~~ 500 (921)
+-. .......+..+.|++++.+.+..+ .+.+++...
T Consensus 218 ~e~---~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~~~ 256 (686)
T PRK10115 218 EEK---DDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDAEL 256 (686)
T ss_pred eeC---CCCEEEEEEEcCCCCEEEEEEECCccccEEEEECcC
Confidence 421 111122444566999887665544 578888543
No 437
>KOG0183 consensus 20S proteasome, regulatory subunit alpha type PSMA7/PRE6 [Posttranslational modification, protein turnover, chaperones]
Probab=23.95 E-value=47 Score=35.61 Aligned_cols=19 Identities=47% Similarity=0.730 Sum_probs=14.7
Q ss_pred cEEEEccCCcEEE--Eeeecc
Q 002446 611 HLLVFSPSGCMIQ--YALRIS 629 (921)
Q Consensus 611 ~L~v~sp~G~liq--y~L~p~ 629 (921)
-|-||+|||||+| |.++..
T Consensus 7 altvFSPDGhL~QVEYAqEAv 27 (249)
T KOG0183|consen 7 ALTVFSPDGHLFQVEYAQEAV 27 (249)
T ss_pred ceEEECCCCCEEeeHhHHHHH
Confidence 5789999999988 555544
No 438
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=23.76 E-value=8e+02 Score=27.55 Aligned_cols=55 Identities=11% Similarity=0.117 Sum_probs=40.0
Q ss_pred CCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEe-----cCCCEEEEEeCCCC
Q 002446 389 VGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTAS-----VQGHNINIFKIIPG 443 (921)
Q Consensus 389 ~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS-----~DGt~IrIWdi~~g 443 (921)
...|.+||..+.+=..--.+-.+.|++|.|..+.++||.+. .....+-.||....
T Consensus 15 C~~lC~yd~~~~qW~~~g~~i~G~V~~l~~~~~~~Llv~G~ft~~~~~~~~la~yd~~~~ 74 (281)
T PF12768_consen 15 CPGLCLYDTDNSQWSSPGNGISGTVTDLQWASNNQLLVGGNFTLNGTNSSNLATYDFKNQ 74 (281)
T ss_pred CCEEEEEECCCCEeecCCCCceEEEEEEEEecCCEEEEEEeeEECCCCceeEEEEecCCC
Confidence 34689999988754433344567899999998888888876 23345788888764
No 439
>PF07995 GSDH: Glucose / Sorbosone dehydrogenase; InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=23.69 E-value=4.1e+02 Score=30.13 Aligned_cols=80 Identities=16% Similarity=0.150 Sum_probs=43.5
Q ss_pred ceEEEeccCCCCeEEEEECC-------CCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 401 NVIAQFRAHKSPISALCFDP-------SGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 401 ~~l~~~~aH~~pIsaLaFSP-------dGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
.++..+.+|. +++.+.|-+ .|.+|++.- .+..|....+.+. .......++. +....++.
T Consensus 244 ~P~~~~~~~~-ap~G~~~y~g~~fp~~~g~~~~~~~-~~~~i~~~~~~~~-----------~~~~~~~~~~-~~~~~r~~ 309 (331)
T PF07995_consen 244 PPVFAYPPHS-APTGIIFYRGSAFPEYRGDLFVADY-GGGRIWRLDLDED-----------GSVTEEEEFL-GGFGGRPR 309 (331)
T ss_dssp --SEEETTT---EEEEEEE-SSSSGGGTTEEEEEET-TTTEEEEEEEETT-----------EEEEEEEEEC-TTSSS-EE
T ss_pred ccceeecCcc-ccCceEEECCccCccccCcEEEecC-CCCEEEEEeeecC-----------CCccceEEcc-ccCCCCce
Confidence 3556677674 556667764 455555544 4443555555432 0122223332 22333699
Q ss_pred EEEEccCCCEEEEEeCCCcEE
Q 002446 474 DISFSDDSNWIMISSSRGTSH 494 (921)
Q Consensus 474 sIaFSPDg~~LAsgS~DgTVh 494 (921)
+|++.|||.+.++...+|+|.
T Consensus 310 ~v~~~pDG~Lyv~~d~~G~iy 330 (331)
T PF07995_consen 310 DVAQGPDGALYVSDDSDGKIY 330 (331)
T ss_dssp EEEEETTSEEEEEE-TTTTEE
T ss_pred EEEEcCCCeEEEEECCCCeEe
Confidence 999999999999888888763
No 440
>PF12341 DUF3639: Protein of unknown function (DUF3639) ; InterPro: IPR022100 This domain family is found in eukaryotes, and is approximately 30 amino acids in length. The family is found in association with PF00400 from PFAM. There are two completely conserved residues (E and R) that may be functionally important.
Probab=23.56 E-value=1.5e+02 Score=21.83 Aligned_cols=24 Identities=29% Similarity=0.725 Sum_probs=19.8
Q ss_pred EEEEEEccCCCEEEEEeCCCcEEEEe
Q 002446 472 IQDISFSDDSNWIMISSSRGTSHLFA 497 (921)
Q Consensus 472 I~sIaFSPDg~~LAsgS~DgTVhVWd 497 (921)
|.+|+-++ .|+|++++.+-+|||.
T Consensus 4 i~aia~g~--~~vavaTS~~~lRifs 27 (27)
T PF12341_consen 4 IEAIAAGD--SWVAVATSAGYLRIFS 27 (27)
T ss_pred EEEEEccC--CEEEEEeCCCeEEecC
Confidence 67777764 5999999999999983
No 441
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=23.36 E-value=2e+02 Score=32.92 Aligned_cols=64 Identities=16% Similarity=0.243 Sum_probs=36.6
Q ss_pred CCCeEEEEECCCCCEEEEEecCCCE----------------EEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEE
Q 002446 410 KSPISALCFDPSGILLVTASVQGHN----------------INIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQ 473 (921)
Q Consensus 410 ~~pIsaLaFSPdGtlLATaS~DGt~----------------IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~ 473 (921)
......++|.|||++.++-+..+.. =.||.+.+. +. .+..+..|+.+ .+
T Consensus 123 ~~~~~~l~~gpDG~LYv~~G~~~~~~~~~~~~~~~~~~~~~g~i~r~~pd-----------g~--~~e~~a~G~rn--p~ 187 (367)
T TIGR02604 123 HHSLNSLAWGPDGWLYFNHGNTLASKVTRPGTSDESRQGLGGGLFRYNPD-----------GG--KLRVVAHGFQN--PY 187 (367)
T ss_pred cccccCceECCCCCEEEecccCCCceeccCCCccCcccccCceEEEEecC-----------CC--eEEEEecCcCC--Cc
Confidence 3457789999999988776532110 023333322 00 11122344322 57
Q ss_pred EEEEccCCCEEEEEe
Q 002446 474 DISFSDDSNWIMISS 488 (921)
Q Consensus 474 sIaFSPDg~~LAsgS 488 (921)
.++|+|+|+++++-.
T Consensus 188 Gl~~d~~G~l~~tdn 202 (367)
T TIGR02604 188 GHSVDSWGDVFFCDN 202 (367)
T ss_pred cceECCCCCEEEEcc
Confidence 899999999987654
No 442
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=22.91 E-value=1.9e+02 Score=26.97 Aligned_cols=46 Identities=11% Similarity=0.169 Sum_probs=30.3
Q ss_pred ccCCCCEEEEEECCCCceEEEeccCCCCeEEEEECCCCCEEEEEecC
Q 002446 385 DADNVGMVIVRDIVSKNVIAQFRAHKSPISALCFDPSGILLVTASVQ 431 (921)
Q Consensus 385 s~~~~G~V~IwDl~s~~~l~~~~aH~~pIsaLaFSPdGtlLATaS~D 431 (921)
++...|.+.-||..+++....+.+-. --+.|+++||++.|+.+-.-
T Consensus 32 e~~~~GRll~ydp~t~~~~vl~~~L~-fpNGVals~d~~~vlv~Et~ 77 (89)
T PF03088_consen 32 EGRPTGRLLRYDPSTKETTVLLDGLY-FPNGVALSPDESFVLVAETG 77 (89)
T ss_dssp HT---EEEEEEETTTTEEEEEEEEES-SEEEEEE-TTSSEEEEEEGG
T ss_pred cCCCCcCEEEEECCCCeEEEehhCCC-ccCeEEEcCCCCEEEEEecc
Confidence 44567999999999987644444322 34779999999987776543
No 443
>PF14269 Arylsulfotran_2: Arylsulfotransferase (ASST)
Probab=22.35 E-value=2.8e+02 Score=31.31 Aligned_cols=71 Identities=24% Similarity=0.342 Sum_probs=45.9
Q ss_pred eEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEeccccccc----EEEEEEccCCCEEEEEe
Q 002446 413 ISALCFDPSGILLVTASVQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAV----IQDISFSDDSNWIMISS 488 (921)
Q Consensus 413 IsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~----I~sIaFSPDg~~LAsgS 488 (921)
|++|...++|.+|+++-.-. .|-+.|-.++ .-++.| .|.+... -...+|-+|-+++-.+.
T Consensus 146 iNsV~~~~~G~yLiS~R~~~-~i~~I~~~tG--------------~I~W~l-gG~~~~df~~~~~~f~~QHdar~~~~~~ 209 (299)
T PF14269_consen 146 INSVDKDDDGDYLISSRNTS-TIYKIDPSTG--------------KIIWRL-GGKRNSDFTLPATNFSWQHDARFLNESN 209 (299)
T ss_pred eeeeeecCCccEEEEecccC-EEEEEECCCC--------------cEEEEe-CCCCCCcccccCCcEeeccCCEEeccCC
Confidence 45567888999998876553 3555554443 344555 2321111 12367788999998888
Q ss_pred CCCcEEEEecC
Q 002446 489 SRGTSHLFAIN 499 (921)
Q Consensus 489 ~DgTVhVWdi~ 499 (921)
.+++|.|||=.
T Consensus 210 ~~~~IslFDN~ 220 (299)
T PF14269_consen 210 DDGTISLFDNA 220 (299)
T ss_pred CCCEEEEEcCC
Confidence 99999999973
No 444
>TIGR02608 delta_60_rpt delta-60 repeat domain. This domain occurs in tandem repeats, as many as 13, in proteins from Bdellovibrio bacteriovorus, Azotobacter vinelandii, Geobacter sulfurreducens, Pirellula sp. 1, Myxococcus xanthus, and others, many of which are Deltaproteobacteria. The periodicity of the repeat ranges from about 57 to 61 amino acids, and a core region of about 54 is represented by this model and seed alignment.
Probab=22.25 E-value=1.9e+02 Score=24.57 Aligned_cols=32 Identities=13% Similarity=0.151 Sum_probs=24.3
Q ss_pred EEEEEEccCCCEEEEEeC-----CCcEEEEecCCCCC
Q 002446 472 IQDISFSDDSNWIMISSS-----RGTSHLFAINPLGG 503 (921)
Q Consensus 472 I~sIaFSPDg~~LAsgS~-----DgTVhVWdi~~~g~ 503 (921)
+++++.-|||++|+.|.. +....|+++++-|.
T Consensus 3 ~~~~~~q~DGkIlv~G~~~~~~~~~~~~l~Rln~DGs 39 (55)
T TIGR02608 3 AYAVAVQSDGKILVAGYVDNSSGNNDFVLARLNADGS 39 (55)
T ss_pred eEEEEECCCCcEEEEEEeecCCCcccEEEEEECCCCC
Confidence 578999999999999964 33566777776544
No 445
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=21.76 E-value=1.1e+03 Score=26.17 Aligned_cols=57 Identities=12% Similarity=0.156 Sum_probs=37.6
Q ss_pred CcEEEEEECCCCcEEEEEeCCC-------CEEEEEEcC-------CEEEE--EeCCEEEEEECCCCcEEEEEe
Q 002446 205 PTVVHFYSLRSQSYVHMLKFRS-------PIYSVRCSS-------RVVAI--CQAAQVHCFDAATLEIEYAIL 261 (921)
Q Consensus 205 ~~tVrIWDL~Tg~~V~tL~f~s-------~V~sV~~S~-------riLAV--a~d~~I~IwDl~T~~~l~tL~ 261 (921)
+-+|-.|||+|++.++++.|+. ...++++.. .++=+ +...-|.+||+.+++--+.+.
T Consensus 33 ~pKLv~~Dl~t~~li~~~~~p~~~~~~~s~lndl~VD~~~~~~~~~~aYItD~~~~glIV~dl~~~~s~Rv~~ 105 (287)
T PF03022_consen 33 PPKLVAFDLKTNQLIRRYPFPPDIAPPDSFLNDLVVDVRDGNCDDGFAYITDSGGPGLIVYDLATGKSWRVLH 105 (287)
T ss_dssp --EEEEEETTTTCEEEEEE--CCCS-TCGGEEEEEEECTTTTS-SEEEEEEETTTCEEEEEETTTTEEEEEET
T ss_pred CcEEEEEECCCCcEEEEEECChHHcccccccceEEEEccCCCCcceEEEEeCCCcCcEEEEEccCCcEEEEec
Confidence 3568899999999999999853 455566632 23323 334599999999998655443
No 446
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=21.45 E-value=6.2e+02 Score=29.79 Aligned_cols=90 Identities=14% Similarity=0.285 Sum_probs=53.6
Q ss_pred CeEEEEECCCCCEEEEEecCCCEEEEEeCCCCCCCC-C------------------Cc--------cCCC-Cc-eeE--E
Q 002446 412 PISALCFDPSGILLVTASVQGHNINIFKIIPGILGT-S------------------SA--------CDAG-TS-YVH--L 460 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS~DGt~IrIWdi~~g~~~~-~------------------s~--------~~~~-~~-~~~--l 460 (921)
.|+++.|.++-.-||.+-..|. +-||......... . .. ..+. .. ... +
T Consensus 3 ~v~~vs~a~~t~Elav~~~~Ge-Vv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~l 81 (395)
T PF08596_consen 3 SVTHVSFAPETLELAVGLESGE-VVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLTL 81 (395)
T ss_dssp -EEEEEEETTTTEEEEEETTS--EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEEE
T ss_pred eEEEEEecCCCceEEEEccCCc-EEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchhh
Confidence 5889999999888999999997 7788765431110 0 00 0000 01 111 2
Q ss_pred EEEecccccccEEEEEEccCCCEEEEEeCCCcEEEEecCCCCCceeecC
Q 002446 461 YRLQRGLTNAVIQDISFSDDSNWIMISSSRGTSHLFAINPLGGSVNFQP 509 (921)
Q Consensus 461 ~~l~RG~t~a~I~sIaFSPDg~~LAsgS~DgTVhVWdi~~~g~~~~l~~ 509 (921)
+... ...|..++.| |=-|+|+|..+|++-|.|+. |..+.++.
T Consensus 82 ~~~~----~g~vtal~~S-~iGFvaigy~~G~l~viD~R--GPavI~~~ 123 (395)
T PF08596_consen 82 LDAK----QGPVTALKNS-DIGFVAIGYESGSLVVIDLR--GPAVIYNE 123 (395)
T ss_dssp E-------S-SEEEEEE--BTSEEEEEETTSEEEEEETT--TTEEEEEE
T ss_pred eecc----CCcEeEEecC-CCcEEEEEecCCcEEEEECC--CCeEEeec
Confidence 2222 3459999998 77799999999999999993 33444443
No 447
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=21.30 E-value=4.5e+02 Score=30.13 Aligned_cols=61 Identities=23% Similarity=0.341 Sum_probs=33.8
Q ss_pred CeEEEEECCCCCEEEEEe-----------cCCCEEEEEeCCCCCCCCCCccCCCCceeEEEEEecccccccEEEEEEccC
Q 002446 412 PISALCFDPSGILLVTAS-----------VQGHNINIFKIIPGILGTSSACDAGTSYVHLYRLQRGLTNAVIQDISFSDD 480 (921)
Q Consensus 412 pIsaLaFSPdGtlLATaS-----------~DGt~IrIWdi~~g~~~~~s~~~~~~~~~~l~~l~RG~t~a~I~sIaFSPD 480 (921)
....|+|+++|+++++-. ..+..|.+++-..+ .|. ......+..+.. ....|+|.++
T Consensus 15 ~P~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dg-dG~---------~d~~~vfa~~l~--~p~Gi~~~~~ 82 (367)
T TIGR02604 15 NPIAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADG-DGK---------YDKSNVFAEELS--MVTGLAVAVG 82 (367)
T ss_pred CCceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCC-CCC---------cceeEEeecCCC--CccceeEecC
Confidence 345689999999888753 22323666654332 111 111223323332 2578999999
Q ss_pred CCEEE
Q 002446 481 SNWIM 485 (921)
Q Consensus 481 g~~LA 485 (921)
| .++
T Consensus 83 G-lyV 86 (367)
T TIGR02604 83 G-VYV 86 (367)
T ss_pred C-EEE
Confidence 9 444
No 448
>PF11715 Nup160: Nucleoporin Nup120/160; InterPro: IPR021717 Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=20.86 E-value=1.7e+02 Score=35.34 Aligned_cols=31 Identities=19% Similarity=0.319 Sum_probs=22.9
Q ss_pred CeEEEEECC----CCCEEEEEecCCCEEEEEeCCCC
Q 002446 412 PISALCFDP----SGILLVTASVQGHNINIFKIIPG 443 (921)
Q Consensus 412 pIsaLaFSP----dGtlLATaS~DGt~IrIWdi~~g 443 (921)
.+..+++++ +-++|+|.+.|++ +||||+.++
T Consensus 216 ~~~~~~~~~~~~~~~~~l~tl~~D~~-LRiW~l~t~ 250 (547)
T PF11715_consen 216 VAASLAVSSSEINDDTFLFTLSRDHT-LRIWSLETG 250 (547)
T ss_dssp -EEEEEE-----ETTTEEEEEETTSE-EEEEETTTT
T ss_pred ccceEEEecceeCCCCEEEEEeCCCe-EEEEECCCC
Confidence 344455555 6779999999987 999999987
Done!