Query 043369
Match_columns 526
No_of_seqs 338 out of 1831
Neff 7.8
Searched_HMMs 46136
Date Fri Mar 29 04:21:28 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/043369.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/043369hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PF07250 Glyoxal_oxid_N: Glyox 100.0 3.3E-47 7E-52 368.2 23.5 236 42-294 1-243 (243)
2 KOG4441 Proteins containing BT 100.0 1.3E-36 2.8E-41 331.5 27.6 268 48-401 283-568 (571)
3 KOG4441 Proteins containing BT 100.0 5.4E-35 1.2E-39 318.9 24.7 249 115-438 283-548 (571)
4 PHA02713 hypothetical protein; 100.0 6.5E-33 1.4E-37 303.3 23.3 236 86-389 273-543 (557)
5 PHA02713 hypothetical protein; 100.0 8E-32 1.7E-36 294.7 24.4 253 118-437 259-534 (557)
6 TIGR03547 muta_rot_YjhT mutatr 100.0 9.6E-30 2.1E-34 263.6 27.9 250 110-416 11-333 (346)
7 PRK14131 N-acetylneuraminic ac 100.0 6.6E-28 1.4E-32 252.6 27.2 277 98-436 20-368 (376)
8 PHA02790 Kelch-like protein; P 100.0 8.2E-28 1.8E-32 259.3 23.6 218 90-387 251-478 (480)
9 PLN02153 epithiospecifier prot 100.0 1.7E-26 3.7E-31 238.9 28.7 282 92-416 4-326 (341)
10 PRK14131 N-acetylneuraminic ac 99.9 8.4E-26 1.8E-30 236.7 27.6 285 29-385 18-374 (376)
11 TIGR03548 mutarot_permut cycli 99.9 6.5E-26 1.4E-30 232.8 23.9 252 111-416 8-315 (323)
12 PHA03098 kelch-like protein; P 99.9 6.7E-26 1.5E-30 248.2 24.9 244 86-393 265-525 (534)
13 TIGR03547 muta_rot_YjhT mutatr 99.9 2.4E-25 5.3E-30 230.7 27.6 251 43-357 11-331 (346)
14 PHA02790 Kelch-like protein; P 99.9 4.5E-26 9.7E-31 245.8 22.9 194 161-437 268-471 (480)
15 PLN02193 nitrile-specifier pro 99.9 9.1E-25 2E-29 235.1 31.4 276 88-415 140-454 (470)
16 PLN02153 epithiospecifier prot 99.9 6.9E-25 1.5E-29 226.9 29.0 280 27-379 6-339 (341)
17 TIGR03548 mutarot_permut cycli 99.9 2.1E-24 4.6E-29 221.6 26.5 269 38-357 3-313 (323)
18 PHA03098 kelch-like protein; P 99.9 1.3E-24 2.7E-29 238.1 25.8 248 118-438 252-513 (534)
19 PLN02193 nitrile-specifier pro 99.9 1.7E-23 3.7E-28 225.2 28.4 263 114-438 118-412 (470)
20 cd02851 Galactose_oxidase_C_te 99.9 7.4E-25 1.6E-29 183.4 9.0 78 441-526 1-101 (101)
21 PF09118 DUF1929: Domain of un 99.9 1.3E-24 2.8E-29 182.2 7.4 75 446-525 1-98 (98)
22 KOG4693 Uncharacterized conser 99.7 3E-16 6.6E-21 149.3 20.3 257 108-415 15-313 (392)
23 KOG4693 Uncharacterized conser 99.7 2.2E-15 4.9E-20 143.4 20.9 262 29-357 3-312 (392)
24 KOG0379 Kelch repeat-containin 99.4 1.2E-11 2.6E-16 133.5 22.7 245 107-407 61-333 (482)
25 KOG0379 Kelch repeat-containin 99.4 6.6E-12 1.4E-16 135.5 20.3 211 150-416 56-287 (482)
26 KOG4152 Host cell transcriptio 99.3 4.7E-11 1E-15 122.7 17.2 276 96-415 18-343 (830)
27 KOG1230 Protein containing rep 99.2 1.5E-10 3.3E-15 116.7 15.4 218 117-413 79-316 (521)
28 PF07250 Glyoxal_oxid_N: Glyox 99.0 5.3E-09 1.2E-13 102.0 13.7 133 232-415 48-191 (243)
29 COG3055 Uncharacterized protei 99.0 1E-07 2.2E-12 95.4 21.2 262 99-417 29-362 (381)
30 COG3055 Uncharacterized protei 99.0 4.4E-08 9.4E-13 98.0 18.7 245 27-359 69-361 (381)
31 KOG1230 Protein containing rep 99.0 1.1E-08 2.3E-13 103.6 14.4 193 27-243 107-345 (521)
32 PF13964 Kelch_6: Kelch motif 98.9 1.9E-09 4.2E-14 79.1 5.8 50 336-393 1-50 (50)
33 KOG4152 Host cell transcriptio 98.9 1.8E-08 4E-13 104.0 13.9 220 150-413 28-273 (830)
34 PF01344 Kelch_1: Kelch motif; 98.6 4.6E-08 1E-12 70.6 3.3 47 336-390 1-47 (47)
35 smart00612 Kelch Kelch domain. 98.6 7.8E-08 1.7E-12 68.9 4.3 45 349-401 1-45 (47)
36 PF13964 Kelch_6: Kelch motif 98.3 1.1E-06 2.3E-11 64.4 4.5 46 107-155 2-50 (50)
37 PF13418 Kelch_4: Galactose ox 98.2 1E-06 2.2E-11 64.2 3.2 48 336-390 1-48 (49)
38 PF07646 Kelch_2: Kelch motif; 98.1 4.9E-06 1.1E-10 60.6 5.4 49 336-390 1-49 (49)
39 PF13415 Kelch_3: Galactose ox 98.1 4.5E-06 9.7E-11 60.9 4.8 48 347-400 1-48 (49)
40 smart00612 Kelch Kelch domain. 98.1 7.3E-06 1.6E-10 58.4 5.3 43 118-163 1-45 (47)
41 PF13415 Kelch_3: Galactose ox 97.5 0.00015 3.2E-09 52.8 4.5 44 116-162 1-48 (49)
42 PF01344 Kelch_1: Kelch motif; 97.5 3.3E-05 7.2E-10 55.4 0.9 43 107-152 2-47 (47)
43 PLN02772 guanylate kinase 97.5 0.00038 8.2E-09 72.4 8.2 71 336-415 24-97 (398)
44 PRK11138 outer membrane biogen 97.4 0.13 2.8E-06 54.3 27.8 241 86-412 80-343 (394)
45 PF07646 Kelch_2: Kelch motif; 97.1 0.00063 1.4E-08 49.4 4.0 41 108-151 3-48 (49)
46 PRK13684 Ycf48-like protein; P 97.1 0.49 1.1E-05 49.0 31.4 74 325-413 245-322 (334)
47 PF13418 Kelch_4: Galactose ox 96.9 0.0011 2.3E-08 48.0 3.8 39 154-197 1-45 (49)
48 COG4257 Vgb Streptogramin lyas 96.8 0.38 8.3E-06 47.5 21.4 226 87-397 85-320 (353)
49 PRK11138 outer membrane biogen 96.8 0.85 1.8E-05 48.1 26.3 242 85-412 130-384 (394)
50 PLN02772 guanylate kinase 96.3 0.012 2.7E-07 61.4 7.9 69 106-175 24-96 (398)
51 TIGR03866 PQQ_ABC_repeats PQQ- 95.4 3.1 6.7E-05 40.8 27.4 133 86-243 12-150 (300)
52 PF13854 Kelch_5: Kelch motif 95.4 0.034 7.4E-07 38.9 4.6 41 333-380 1-41 (42)
53 cd00200 WD40 WD40 domain, foun 94.9 3.6 7.9E-05 38.9 25.7 132 87-241 33-168 (289)
54 KOG0310 Conserved WD40 repeat- 94.5 3.5 7.6E-05 43.6 18.4 245 84-415 47-301 (487)
55 TIGR03866 PQQ_ABC_repeats PQQ- 94.1 6.3 0.00014 38.6 25.9 133 86-243 54-192 (300)
56 PF14870 PSII_BNR: Photosynthe 94.1 2.1 4.6E-05 43.6 15.6 163 26-232 132-297 (302)
57 TIGR01640 F_box_assoc_1 F-box 94.0 4.4 9.5E-05 39.2 17.4 143 85-240 70-230 (230)
58 PF10282 Lactonase: Lactonase, 94.0 8.7 0.00019 39.7 22.9 150 86-241 16-177 (345)
59 TIGR03300 assembly_YfgL outer 93.7 10 0.00022 39.5 26.2 246 85-413 115-370 (377)
60 TIGR03300 assembly_YfgL outer 93.5 11 0.00023 39.3 28.6 86 86-186 76-165 (377)
61 KOG2437 Muskelin [Signal trans 93.4 0.11 2.4E-06 54.9 4.9 155 221-413 272-456 (723)
62 KOG0286 G-protein beta subunit 92.9 11 0.00024 37.7 24.1 243 87-413 79-335 (343)
63 PF13854 Kelch_5: Kelch motif 92.8 0.12 2.5E-06 36.1 3.0 24 151-175 1-24 (42)
64 PRK13684 Ycf48-like protein; P 92.5 11 0.00023 39.1 18.3 122 90-231 199-323 (334)
65 PRK11028 6-phosphogluconolacto 91.7 17 0.00037 37.0 28.6 90 87-182 59-153 (330)
66 PF07893 DUF1668: Protein of u 91.6 2.9 6.2E-05 43.4 12.8 119 113-244 73-213 (342)
67 COG4257 Vgb Streptogramin lyas 91.0 18 0.0004 36.1 19.5 148 87-257 126-279 (353)
68 KOG0310 Conserved WD40 repeat- 89.7 29 0.00063 37.0 17.9 84 87-182 135-222 (487)
69 PF13360 PQQ_2: PQQ-like domai 89.5 20 0.00043 34.2 20.9 132 86-242 4-144 (238)
70 TIGR01640 F_box_assoc_1 F-box 88.9 10 0.00022 36.5 13.5 154 221-413 5-162 (230)
71 KOG2437 Muskelin [Signal trans 88.2 0.69 1.5E-05 49.2 4.9 117 117-243 273-417 (723)
72 KOG0315 G-protein beta subunit 87.3 31 0.00068 33.9 20.4 220 113-415 48-280 (311)
73 PLN00181 protein SPA1-RELATED; 87.1 44 0.00094 38.8 19.5 230 111-415 489-730 (793)
74 PRK11028 6-phosphogluconolacto 87.0 37 0.00081 34.4 27.6 138 87-241 14-159 (330)
75 PF08450 SGL: SMP-30/Gluconola 86.0 22 0.00048 34.5 14.1 144 88-246 63-220 (246)
76 PF07893 DUF1668: Protein of u 85.6 26 0.00056 36.4 14.9 60 41-126 68-127 (342)
77 PF08450 SGL: SMP-30/Gluconola 85.3 12 0.00026 36.4 11.8 25 220-244 50-74 (246)
78 KOG0315 G-protein beta subunit 85.1 41 0.00089 33.1 18.6 51 85-138 61-113 (311)
79 PF13360 PQQ_2: PQQ-like domai 84.6 16 0.00035 34.8 12.3 140 218-414 33-183 (238)
80 COG5184 ATS1 Alpha-tubulin sup 79.6 94 0.002 33.4 18.2 83 89-175 90-204 (476)
81 PF13088 BNR_2: BNR repeat-lik 78.9 8.2 0.00018 38.1 8.1 119 28-170 145-275 (275)
82 cd00200 WD40 WD40 domain, foun 78.5 58 0.0013 30.4 22.1 135 86-243 74-212 (289)
83 PF13088 BNR_2: BNR repeat-lik 78.3 24 0.00052 34.7 11.2 129 91-226 141-275 (275)
84 KOG0266 WD40 repeat-containing 77.7 1.1E+02 0.0023 33.0 22.0 117 103-241 201-321 (456)
85 KOG0278 Serine/threonine kinas 77.1 55 0.0012 32.3 12.5 175 111-357 106-288 (334)
86 PLN00033 photosystem II stabil 75.2 1.2E+02 0.0026 32.3 16.4 122 89-231 264-391 (398)
87 KOG0291 WD40-repeat-containing 73.2 1.7E+02 0.0038 33.3 25.1 50 86-138 331-380 (893)
88 PF10282 Lactonase: Lactonase, 73.1 1.2E+02 0.0025 31.3 22.0 58 315-387 268-332 (345)
89 PTZ00421 coronin; Provisional 72.0 1.6E+02 0.0034 32.3 22.3 109 116-243 87-203 (493)
90 PTZ00421 coronin; Provisional 71.7 1.6E+02 0.0035 32.2 17.3 53 86-142 149-201 (493)
91 KOG0271 Notchless-like WD40 re 71.5 18 0.00039 37.6 8.0 52 86-141 138-189 (480)
92 KOG0296 Angio-associated migra 70.8 1.4E+02 0.003 31.1 14.4 133 86-244 87-226 (399)
93 KOG0279 G protein beta subunit 69.7 1.2E+02 0.0026 30.5 12.9 136 87-241 87-225 (315)
94 KOG2055 WD40 repeat protein [G 68.6 1.7E+02 0.0037 31.3 14.9 112 114-243 222-338 (514)
95 PTZ00420 coronin; Provisional 68.5 1.6E+02 0.0035 32.8 15.5 135 86-241 149-296 (568)
96 KOG2055 WD40 repeat protein [G 66.9 1.2E+02 0.0026 32.4 13.1 133 85-239 280-418 (514)
97 KOG0289 mRNA splicing factor [ 62.2 1.5E+02 0.0033 31.5 12.7 121 213-390 350-473 (506)
98 PRK04792 tolB translocation pr 61.4 1.5E+02 0.0034 31.7 13.6 91 86-182 287-377 (448)
99 PF12768 Rax2: Cortical protei 60.8 71 0.0015 32.2 10.0 96 27-146 25-128 (281)
100 KOG0271 Notchless-like WD40 re 60.7 12 0.00026 38.8 4.4 57 345-416 124-180 (480)
101 cd00216 PQQ_DH Dehydrogenases 60.2 2.1E+02 0.0045 31.2 14.4 26 218-243 58-86 (488)
102 PLN00181 protein SPA1-RELATED; 57.7 3.6E+02 0.0077 31.3 24.9 103 116-241 544-651 (793)
103 PF14870 PSII_BNR: Photosynthe 54.1 2.6E+02 0.0056 28.5 20.0 241 94-414 5-253 (302)
104 KOG0299 U3 snoRNP-associated p 51.9 1.6E+02 0.0034 31.5 10.9 143 42-237 206-353 (479)
105 COG1520 FOG: WD40-like repeat 50.6 2.5E+02 0.0055 29.0 12.7 79 316-412 123-205 (370)
106 TIGR03075 PQQ_enz_alc_DH PQQ-d 49.4 1.8E+02 0.004 32.1 11.8 60 316-384 132-196 (527)
107 KOG0266 WD40 repeat-containing 48.7 3.7E+02 0.0081 28.9 22.8 233 112-438 166-411 (456)
108 KOG0286 G-protein beta subunit 47.3 3.2E+02 0.007 27.7 21.1 240 48-357 75-336 (343)
109 PRK03629 tolB translocation pr 46.4 3.9E+02 0.0084 28.4 15.8 84 86-175 268-351 (429)
110 KOG0641 WD40 repeat protein [G 45.9 2.9E+02 0.0064 26.9 13.8 29 215-243 236-266 (350)
111 TIGR02800 propeller_TolB tol-p 45.7 3E+02 0.0065 28.6 12.6 91 86-182 259-349 (417)
112 PF12768 Rax2: Cortical protei 45.7 1.6E+02 0.0035 29.6 9.8 59 86-146 17-79 (281)
113 COG1520 FOG: WD40-like repeat 45.6 3.6E+02 0.0079 27.8 22.5 258 87-413 80-354 (370)
114 PF13540 RCC1_2: Regulator of 45.4 19 0.00042 22.9 2.1 22 394-416 8-29 (30)
115 PRK03629 tolB translocation pr 44.8 4.1E+02 0.0089 28.2 18.2 138 86-243 224-368 (429)
116 PLN02919 haloacid dehalogenase 44.6 1.9E+02 0.004 35.0 11.7 63 112-182 810-885 (1057)
117 TIGR02608 delta_60_rpt delta-6 42.1 17 0.00036 27.1 1.6 16 399-414 6-21 (55)
118 TIGR03075 PQQ_enz_alc_DH PQQ-d 42.1 1.3E+02 0.0029 33.1 9.4 93 285-411 68-172 (527)
119 KOG0316 Conserved WD40 repeat- 41.3 1.6E+02 0.0035 28.9 8.4 93 85-185 81-174 (307)
120 PF06433 Me-amine-dh_H: Methyl 40.2 2E+02 0.0043 29.9 9.5 81 85-174 118-215 (342)
121 TIGR02658 TTQ_MADH_Hv methylam 39.0 4.7E+02 0.01 27.3 14.3 17 230-246 279-295 (352)
122 PF08662 eIF2A: Eukaryotic tra 38.3 53 0.0011 30.9 4.8 56 344-413 108-163 (194)
123 PRK05137 tolB translocation pr 37.5 5.2E+02 0.011 27.3 13.4 83 86-174 271-353 (435)
124 PF03089 RAG2: Recombination a 36.6 1.1E+02 0.0024 30.8 6.7 82 332-415 83-175 (337)
125 TIGR02800 propeller_TolB tol-p 35.7 5.2E+02 0.011 26.8 17.0 59 86-146 215-273 (417)
126 PRK04792 tolB translocation pr 35.3 5.9E+02 0.013 27.3 17.2 59 86-146 243-301 (448)
127 KOG0639 Transducin-like enhanc 33.5 5.5E+02 0.012 28.1 11.6 134 86-241 441-584 (705)
128 PRK01742 tolB translocation pr 33.2 4.5E+02 0.0098 27.8 11.6 80 86-172 229-309 (429)
129 KOG0272 U4/U6 small nuclear ri 31.9 72 0.0016 33.6 4.8 86 89-182 287-372 (459)
130 PRK00178 tolB translocation pr 31.3 5.8E+02 0.013 26.8 12.0 107 48-182 252-358 (430)
131 PRK04922 tolB translocation pr 31.1 6.6E+02 0.014 26.6 13.9 81 86-172 273-353 (433)
132 KOG0278 Serine/threonine kinas 31.1 5.4E+02 0.012 25.6 10.8 64 110-182 229-294 (334)
133 KOG0305 Anaphase promoting com 30.1 7.6E+02 0.016 27.0 20.0 82 86-177 198-281 (484)
134 KOG0285 Pleiotropic regulator 29.8 6.7E+02 0.015 26.3 11.5 30 156-186 153-183 (460)
135 cd00216 PQQ_DH Dehydrogenases 29.6 2.9E+02 0.0063 30.0 9.4 95 285-411 60-163 (488)
136 PLN00033 photosystem II stabil 29.0 7.2E+02 0.016 26.4 29.6 70 328-413 318-390 (398)
137 KOG0263 Transcription initiati 28.6 2.9E+02 0.0062 31.4 9.0 88 86-182 558-646 (707)
138 PF07433 DUF1513: Protein of u 28.0 5.6E+02 0.012 26.2 10.3 86 85-174 28-120 (305)
139 PLN02919 haloacid dehalogenase 27.8 2.2E+02 0.0049 34.3 8.7 53 86-142 826-891 (1057)
140 PRK04922 tolB translocation pr 26.6 7.8E+02 0.017 26.0 12.1 82 86-174 317-398 (433)
141 KOG0303 Actin-binding protein 26.5 2.7E+02 0.0058 29.4 7.7 81 86-175 155-237 (472)
142 KOG0289 mRNA splicing factor [ 26.4 7.9E+02 0.017 26.4 11.1 86 86-182 370-457 (506)
143 PF03088 Str_synth: Strictosid 26.4 1.4E+02 0.003 24.6 4.7 68 45-122 4-73 (89)
144 TIGR02658 TTQ_MADH_Hv methylam 26.0 7.7E+02 0.017 25.7 23.8 58 85-144 77-141 (352)
145 COG3490 Uncharacterized protei 25.9 3.1E+02 0.0066 27.9 7.7 106 317-437 94-203 (366)
146 KOG0649 WD40 repeat protein [G 25.8 5.2E+02 0.011 25.6 9.1 40 86-125 179-226 (325)
147 PRK02889 tolB translocation pr 25.3 8.3E+02 0.018 25.8 12.3 112 43-182 244-355 (427)
148 PRK05137 tolB translocation pr 25.2 8.3E+02 0.018 25.8 17.6 59 86-146 227-285 (435)
149 COG3490 Uncharacterized protei 25.1 4.4E+02 0.0095 26.8 8.6 84 85-172 91-179 (366)
150 KOG0272 U4/U6 small nuclear ri 25.1 3.6E+02 0.0078 28.7 8.4 88 86-182 326-415 (459)
151 KOG0647 mRNA export protein (c 24.8 7.6E+02 0.017 25.2 12.7 103 114-241 81-187 (347)
152 KOG0649 WD40 repeat protein [G 24.5 7.1E+02 0.015 24.8 13.4 84 86-176 137-228 (325)
153 KOG1427 Uncharacterized conser 23.8 1.4E+02 0.0029 30.4 4.9 89 396-504 120-212 (443)
154 KOG1036 Mitotic spindle checkp 23.0 2.7E+02 0.0058 28.4 6.8 81 290-409 109-203 (323)
155 COG3386 Gluconolactonase [Carb 22.9 5.8E+02 0.013 26.0 9.6 56 111-174 218-276 (307)
156 PF07433 DUF1513: Protein of u 22.8 8.3E+02 0.018 25.0 13.0 40 221-265 16-58 (305)
157 KOG0639 Transducin-like enhanc 22.5 6.8E+02 0.015 27.4 9.9 97 286-415 476-573 (705)
158 KOG0296 Angio-associated migra 22.4 3E+02 0.0064 28.7 7.1 52 87-142 172-223 (399)
159 PRK01029 tolB translocation pr 21.7 9.8E+02 0.021 25.4 11.6 57 111-172 332-388 (428)
160 PF00400 WD40: WD domain, G-be 21.4 1.1E+02 0.0024 19.7 2.8 23 111-136 17-39 (39)
161 PRK01029 tolB translocation pr 21.3 4.3E+02 0.0092 28.2 8.7 60 85-146 351-410 (428)
162 KOG0291 WD40-repeat-containing 21.2 7.9E+02 0.017 28.3 10.5 56 86-146 459-514 (893)
163 KOG0301 Phospholipase A2-activ 21.1 1.3E+03 0.027 26.4 18.9 85 87-182 37-127 (745)
No 1
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=100.00 E-value=3.3e-47 Score=368.18 Aligned_cols=236 Identities=51% Similarity=0.960 Sum_probs=210.3
Q ss_pred eEEEEecCCeEEEEecccCCCCCccCCCCccccCcc--ccCCCCcceEEEEeCCCCcEEeCccCCccccccceEcCCCcE
Q 043369 42 MHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVE--LETSDCYAHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVL 119 (526)
Q Consensus 42 ~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~--~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l 119 (526)
||++|++++||+++++.+.|+|++.+++|.||.... ..++||++++.+|||.|++++++...++.||+++++|+||++
T Consensus 1 mh~~~~~~~~v~~~d~t~~g~s~~~~~~~~c~~~~~~~~~~~d~~a~s~~yD~~tn~~rpl~v~td~FCSgg~~L~dG~l 80 (243)
T PF07250_consen 1 MHMALLHNNKVIMFDRTNFGPSNISLPDGRCRDNPEDNALKFDGPAHSVEYDPNTNTFRPLTVQTDTFCSGGAFLPDGRL 80 (243)
T ss_pred CeEeEccCCEEEEEeCCCcccccccCCCCccccCccccccccCceEEEEEEecCCCcEEeccCCCCCcccCcCCCCCCCE
Confidence 799999999999999999999999999999998765 568899999999999999999999999999999999999999
Q ss_pred EEEcCCCCCccEEEEEcCCC---CCCcccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEEEcCCCCCCCcceeec
Q 043369 120 VQTGGYRLGERVVRYLKPCS---DCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQL 196 (526)
Q Consensus 120 ~v~GG~~~g~~~v~~ydp~~---t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~ 196 (526)
+++||+.+|.+.++.|+|+. +++|.+. +..|..+|||+++++|+||+|+|+||+.++++|+||+... ......+
T Consensus 81 l~tGG~~~G~~~ir~~~p~~~~~~~~w~e~-~~~m~~~RWYpT~~~L~DG~vlIvGG~~~~t~E~~P~~~~--~~~~~~~ 157 (243)
T PF07250_consen 81 LQTGGDNDGNKAIRIFTPCTSDGTCDWTES-PNDMQSGRWYPTATTLPDGRVLIVGGSNNPTYEFWPPKGP--GPGPVTL 157 (243)
T ss_pred EEeCCCCccccceEEEecCCCCCCCCceEC-cccccCCCccccceECCCCCEEEEeCcCCCcccccCCccC--CCCceee
Confidence 99999988999999999993 3899998 4579999999999999999999999999999999976421 0133445
Q ss_pred CCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEeccCCeEEEeccCCCCCCCCccCCCCceeeccc--cccccc
Q 043369 197 PFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPV--NLSSIN 274 (526)
Q Consensus 197 p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~--~~~~~~ 274 (526)
+++..+.+. .+.++||++++++||+||+++++.+++||++++++.+.+|.+|.+ .|.||.+|++||||| .+
T Consensus 158 ~~l~~~~~~--~~~nlYP~~~llPdG~lFi~an~~s~i~d~~~n~v~~~lP~lPg~-~R~YP~sgssvmLPl~~~~---- 230 (243)
T PF07250_consen 158 PFLSQTSDT--LPNNLYPFVHLLPDGNLFIFANRGSIIYDYKTNTVVRTLPDLPGG-PRNYPASGSSVMLPLTDTP---- 230 (243)
T ss_pred ecchhhhcc--CccccCceEEEcCCCCEEEEEcCCcEEEeCCCCeEEeeCCCCCCC-ceecCCCcceEEecCccCC----
Confidence 566544332 568999999999999999999999999999999987789999998 899999999999999 43
Q ss_pred ccccCCCCCccCcEEEEEcC
Q 043369 275 VHINNNNKPVVHSQVLICGG 294 (526)
Q Consensus 275 ~~~~~~~~~~~~gkI~v~GG 294 (526)
.+++..+|+||||
T Consensus 231 -------~~~~~~evlvCGG 243 (243)
T PF07250_consen 231 -------PNNYTAEVLVCGG 243 (243)
T ss_pred -------CCCCCeEEEEeCC
Confidence 5668999999998
No 2
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=100.00 E-value=1.3e-36 Score=331.52 Aligned_cols=268 Identities=21% Similarity=0.273 Sum_probs=222.0
Q ss_pred cCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCC
Q 043369 48 PNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRL 127 (526)
Q Consensus 48 ~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~ 127 (526)
..++++++||... ++. ....+++|||.+++|..++.++..+|..+++..+|.||++||...
T Consensus 283 ~~~~l~~vGG~~~--------~~~-----------~~~~ve~yd~~~~~w~~~a~m~~~r~~~~~~~~~~~lYv~GG~~~ 343 (571)
T KOG4441|consen 283 VSGKLVAVGGYNR--------QGQ-----------SLRSVECYDPKTNEWSSLAPMPSPRCRVGVAVLNGKLYVVGGYDS 343 (571)
T ss_pred CCCeEEEECCCCC--------CCc-----------ccceeEEecCCcCcEeecCCCCcccccccEEEECCEEEEEccccC
Confidence 4688999999852 111 235689999999999999999999999999999999999999973
Q ss_pred ---CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeec-CC
Q 043369 128 ---GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQL-PF 198 (526)
Q Consensus 128 ---g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~-p~ 198 (526)
..+++++|||. +++|+.. ++|+.+|+.++++++ +|+||++||+++ .++|+| |.++ +|... ||
T Consensus 344 ~~~~l~~ve~YD~~-~~~W~~~--a~M~~~R~~~~v~~l-~g~iYavGG~dg~~~l~svE~YDp~~~-----~W~~va~m 414 (571)
T KOG4441|consen 344 GSDRLSSVERYDPR-TNQWTPV--APMNTKRSDFGVAVL-DGKLYAVGGFDGEKSLNSVECYDPVTN-----KWTPVAPM 414 (571)
T ss_pred CCcccceEEEecCC-CCceecc--CCccCccccceeEEE-CCEEEEEeccccccccccEEEecCCCC-----cccccCCC
Confidence 25899999999 9999998 689999999999999 999999999986 379999 9988 78765 55
Q ss_pred ccccCCCCCCCCCCcceEEEecCCcEEEEEc--------cceEEEeccCCeEEEeccCCCCCCCCccCCCCceeeccccc
Q 043369 199 LKETMHSPKIPNNLYPFLHLSTDGNLFIFAN--------DRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNL 270 (526)
Q Consensus 199 l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg--------~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~ 270 (526)
+.. .+.++.+..+|+||++|| +++|+|||.+|+|. .+|+|+. +|.+ .|.++
T Consensus 415 ~~~----------r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YDP~t~~W~-~~~~M~~--~R~~--~g~a~------ 473 (571)
T KOG4441|consen 415 LTR----------RSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYDPETNTWT-LIAPMNT--RRSG--FGVAV------ 473 (571)
T ss_pred Ccc----------eeeeEEEEECCEEEEEcCcCCCccccceEEEEcCCCCcee-ecCCccc--cccc--ceEEE------
Confidence 432 245677888999999999 35799999999998 5775554 5765 45555
Q ss_pred ccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccccccceEEeCCCc
Q 043369 271 SSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGD 349 (526)
Q Consensus 271 ~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~ 349 (526)
++++||++||.+. . ..+.++|+|||. .++|+.. +|+.+|..+..+++ +++
T Consensus 474 --------------~~~~iYvvGG~~~-~-----------~~~~~VE~ydp~--~~~W~~v~~m~~~rs~~g~~~~-~~~ 524 (571)
T KOG4441|consen 474 --------------LNGKIYVVGGFDG-T-----------SALSSVERYDPE--TNQWTMVAPMTSPRSAVGVVVL-GGK 524 (571)
T ss_pred --------------ECCEEEEECCccC-C-----------CccceEEEEcCC--CCceeEcccCccccccccEEEE-CCE
Confidence 4999999999873 1 346789999997 6999997 89999998886665 999
Q ss_pred EEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCcccccccccee
Q 043369 350 VLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHL 401 (526)
Q Consensus 350 V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~L 401 (526)
+|++||.. | .....++|+|||++|+|+..+++...|.+.+++++
T Consensus 525 ly~vGG~~-~-------~~~l~~ve~ydp~~d~W~~~~~~~~~~~~~~~~~~ 568 (571)
T KOG4441|consen 525 LYAVGGFD-G-------NNNLNTVECYDPETDTWTEVTEPESGRGGAGVAVI 568 (571)
T ss_pred EEEEeccc-C-------ccccceeEEcCCCCCceeeCCCccccccCcceEEe
Confidence 99999975 3 22455899999999999999998888887776654
No 3
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=100.00 E-value=5.4e-35 Score=318.88 Aligned_cols=249 Identities=24% Similarity=0.314 Sum_probs=202.0
Q ss_pred CCCcEEEEcCCCC---CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCcc-C----CeEEEE-cCC
Q 043369 115 ANGVLVQTGGYRL---GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRF-Q----FTYEFI-PRT 185 (526)
Q Consensus 115 ~~G~l~v~GG~~~---g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~-~----~~~E~y-P~~ 185 (526)
..+.|+++||... ..+.+++|||. ++.|... ++|+.+|..++++++ +|+|||+||.+ + .++|+| |.+
T Consensus 283 ~~~~l~~vGG~~~~~~~~~~ve~yd~~-~~~w~~~--a~m~~~r~~~~~~~~-~~~lYv~GG~~~~~~~l~~ve~YD~~~ 358 (571)
T KOG4441|consen 283 VSGKLVAVGGYNRQGQSLRSVECYDPK-TNEWSSL--APMPSPRCRVGVAVL-NGKLYVVGGYDSGSDRLSSVERYDPRT 358 (571)
T ss_pred CCCeEEEECCCCCCCcccceeEEecCC-cCcEeec--CCCCcccccccEEEE-CCEEEEEccccCCCcccceEEEecCCC
Confidence 3589999999873 25899999999 9999999 799999999999998 89999999999 3 379999 998
Q ss_pred CCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc-------eEEEeccCCeEEEeccCCCCCCCCccC
Q 043369 186 SDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR-------AILLDYVNNRVMKNYPVMPGGISRNYP 258 (526)
Q Consensus 186 ~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~-------~~~yDp~t~~w~~~~p~~p~~~~r~y~ 258 (526)
+ +|..++.|...+. -+..+..+|+||++||.+ +|+|||.+|+|. ..++|+. +|..
T Consensus 359 ~-----~W~~~a~M~~~R~---------~~~v~~l~g~iYavGG~dg~~~l~svE~YDp~~~~W~-~va~m~~--~r~~- 420 (571)
T KOG4441|consen 359 N-----QWTPVAPMNTKRS---------DFGVAVLDGKLYAVGGFDGEKSLNSVECYDPVTNKWT-PVAPMLT--RRSG- 420 (571)
T ss_pred C-----ceeccCCccCccc---------cceeEEECCEEEEEeccccccccccEEEecCCCCccc-ccCCCCc--ceee-
Confidence 8 7887654433221 245677799999999964 899999999998 4554444 4542
Q ss_pred CCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccc
Q 043369 259 STGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNR 337 (526)
Q Consensus 259 ~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R 337 (526)
+|+++ .+|+||++||.+.. ...++++|+|||. +++|+.. +|+.+|
T Consensus 421 -~gv~~--------------------~~g~iYi~GG~~~~-----------~~~l~sve~YDP~--t~~W~~~~~M~~~R 466 (571)
T KOG4441|consen 421 -HGVAV--------------------LGGKLYIIGGGDGS-----------SNCLNSVECYDPE--TNTWTLIAPMNTRR 466 (571)
T ss_pred -eEEEE--------------------ECCEEEEEcCcCCC-----------ccccceEEEEcCC--CCceeecCCccccc
Confidence 34444 49999999998632 1258999999997 6999987 999999
Q ss_pred cccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCCC
Q 043369 338 VMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNVN 417 (526)
Q Consensus 338 ~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~~ 417 (526)
.+++++++ +|+||++||.+ +. ....++|.|||.+++|+.+++|+.+|..++++++ +|++|+.||.....
T Consensus 467 ~~~g~a~~-~~~iYvvGG~~-~~-------~~~~~VE~ydp~~~~W~~v~~m~~~rs~~g~~~~--~~~ly~vGG~~~~~ 535 (571)
T KOG4441|consen 467 SGFGVAVL-NGKIYVVGGFD-GT-------SALSSVERYDPETNQWTMVAPMTSPRSAVGVVVL--GGKLYAVGGFDGNN 535 (571)
T ss_pred ccceEEEE-CCEEEEECCcc-CC-------CccceEEEEcCCCCceeEcccCccccccccEEEE--CCEEEEEecccCcc
Confidence 99997776 99999999987 31 2345799999999999999999999999998887 99999999954432
Q ss_pred CCcCCCCCCceeeEEEcCccc
Q 043369 418 YNFSALFPTELSLQAFYPPYF 438 (526)
Q Consensus 418 ~~~~~~~p~~~~vE~y~Ppyl 438 (526)
+ ..++|+|+|.-=
T Consensus 536 ------~--l~~ve~ydp~~d 548 (571)
T KOG4441|consen 536 ------N--LNTVECYDPETD 548 (571)
T ss_pred ------c--cceeEEcCCCCC
Confidence 2 458999988764
No 4
>PHA02713 hypothetical protein; Provisional
Probab=100.00 E-value=6.5e-33 Score=303.27 Aligned_cols=236 Identities=13% Similarity=0.122 Sum_probs=188.2
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCC---CccEEEEEcCCCCCCcccccCCCCCcccccceeEE
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRL---GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQI 162 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~---g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~ 162 (526)
..++|||.+++|+.++.++..++..+++..+++||++||... ..+.+++|||. +++|.+. ++|+.+|.++++++
T Consensus 273 ~v~~yd~~~~~W~~l~~mp~~r~~~~~a~l~~~IYviGG~~~~~~~~~~v~~Yd~~-~n~W~~~--~~m~~~R~~~~~~~ 349 (557)
T PHA02713 273 CILVYNINTMEYSVISTIPNHIINYASAIVDNEIIIAGGYNFNNPSLNKVYKINIE-NKIHVEL--PPMIKNRCRFSLAV 349 (557)
T ss_pred CEEEEeCCCCeEEECCCCCccccceEEEEECCEEEEEcCCCCCCCccceEEEEECC-CCeEeeC--CCCcchhhceeEEE
Confidence 467899999999999988777777777888999999999742 24789999999 9999998 68999999999998
Q ss_pred ecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------
Q 043369 163 LPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND------- 230 (526)
Q Consensus 163 L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~------- 230 (526)
+ +|+|||+||.++ .++|+| |.++ +|..++.+...+ .-+..+..+|+||++||.
T Consensus 350 ~-~g~IYviGG~~~~~~~~sve~Ydp~~~-----~W~~~~~mp~~r---------~~~~~~~~~g~IYviGG~~~~~~~~ 414 (557)
T PHA02713 350 I-DDTIYAIGGQNGTNVERTIECYTMGDD-----KWKMLPDMPIAL---------SSYGMCVLDQYIYIIGGRTEHIDYT 414 (557)
T ss_pred E-CCEEEEECCcCCCCCCceEEEEECCCC-----eEEECCCCCccc---------ccccEEEECCEEEEEeCCCcccccc
Confidence 8 899999999864 369999 9987 788764443321 113445679999999984
Q ss_pred ------------------ceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEE
Q 043369 231 ------------------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLIC 292 (526)
Q Consensus 231 ------------------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~ 292 (526)
++++|||.+|+|. .+++|+. +|.. ++.++ .+++||++
T Consensus 415 ~~~~~~~~~~~~~~~~~~~ve~YDP~td~W~-~v~~m~~--~r~~--~~~~~--------------------~~~~IYv~ 469 (557)
T PHA02713 415 SVHHMNSIDMEEDTHSSNKVIRYDTVNNIWE-TLPNFWT--GTIR--PGVVS--------------------HKDDIYVV 469 (557)
T ss_pred cccccccccccccccccceEEEECCCCCeEe-ecCCCCc--cccc--CcEEE--------------------ECCEEEEE
Confidence 2689999999998 5776655 4653 34444 48999999
Q ss_pred cCCCCCCCchhhhhhcccccccceEEEEeecCC-CCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCc
Q 043369 293 GGTLPDSNENAAEAQIFLPAAKSCGRLTITAQN-PKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPV 370 (526)
Q Consensus 293 GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~-~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~ 370 (526)
||.+... ...+++|+|||. + ++|+.. +|+.+|..++++++ +|+||++||.+ |.
T Consensus 470 GG~~~~~-----------~~~~~ve~Ydp~--~~~~W~~~~~m~~~r~~~~~~~~-~~~iyv~Gg~~-~~---------- 524 (557)
T PHA02713 470 CDIKDEK-----------NVKTCIFRYNTN--TYNGWELITTTESRLSALHTILH-DNTIMMLHCYE-SY---------- 524 (557)
T ss_pred eCCCCCC-----------ccceeEEEecCC--CCCCeeEccccCcccccceeEEE-CCEEEEEeeec-ce----------
Confidence 9975211 123568999986 5 699986 99999999888776 99999999976 31
Q ss_pred cccEEEeCCCCcEeecCCC
Q 043369 371 LNPVIYCPKINRFRILSPS 389 (526)
Q Consensus 371 ~~~e~YDP~t~~Wt~~a~~ 389 (526)
.++|+|||.+++|+.+++.
T Consensus 525 ~~~e~yd~~~~~W~~~~~~ 543 (557)
T PHA02713 525 MLQDTFNVYTYEWNHICHQ 543 (557)
T ss_pred eehhhcCcccccccchhhh
Confidence 2689999999999998875
No 5
>PHA02713 hypothetical protein; Provisional
Probab=100.00 E-value=8e-32 Score=294.70 Aligned_cols=253 Identities=12% Similarity=0.102 Sum_probs=188.1
Q ss_pred cEEEEcCCCC-CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC-----CeEEEE-cCCCCCCC
Q 043369 118 VLVQTGGYRL-GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ-----FTYEFI-PRTSDSDR 190 (526)
Q Consensus 118 ~l~v~GG~~~-g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~-----~~~E~y-P~~~~~~~ 190 (526)
.+++.||... ....+++|||. +++|..+ ++|+.+|.+++++++ +|+|||+||.+. .++|+| |.++
T Consensus 259 ~l~~~~g~~~~~~~~v~~yd~~-~~~W~~l--~~mp~~r~~~~~a~l-~~~IYviGG~~~~~~~~~~v~~Yd~~~n---- 330 (557)
T PHA02713 259 CLVCHDTKYNVCNPCILVYNIN-TMEYSVI--STIPNHIINYASAIV-DNEIIIAGGYNFNNPSLNKVYKINIENK---- 330 (557)
T ss_pred EEEEecCccccCCCCEEEEeCC-CCeEEEC--CCCCccccceEEEEE-CCEEEEEcCCCCCCCccceEEEEECCCC----
Confidence 3555555321 12468999999 9999999 689999999888888 899999999741 368999 9887
Q ss_pred cceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------ceEEEeccCCeEEEeccCCCCCCCCccCCCCce
Q 043369 191 KILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSS 263 (526)
Q Consensus 191 ~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~ 263 (526)
.|..++.|...+ .-+..+..+|+||++||. ++|+|||.+++|. .+++||. +|.. ++++
T Consensus 331 -~W~~~~~m~~~R---------~~~~~~~~~g~IYviGG~~~~~~~~sve~Ydp~~~~W~-~~~~mp~--~r~~--~~~~ 395 (557)
T PHA02713 331 -IHVELPPMIKNR---------CRFSLAVIDDTIYAIGGQNGTNVERTIECYTMGDDKWK-MLPDMPI--ALSS--YGMC 395 (557)
T ss_pred -eEeeCCCCcchh---------hceeEEEECCEEEEECCcCCCCCCceEEEEECCCCeEE-ECCCCCc--cccc--ccEE
Confidence 787765443321 123556779999999995 3799999999998 5777766 4653 3433
Q ss_pred eecccccccccccccCCCCCccCcEEEEEcCCCCCC-Cchhh--hh----hcccccccceEEEEeecCCCCceec-ccCc
Q 043369 264 VLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDS-NENAA--EA----QIFLPAAKSCGRLTITAQNPKWEME-EMPL 335 (526)
Q Consensus 264 v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~-~~~~~--~~----~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~ 335 (526)
+ .+++||++||.+... +.... +. .. ...++++++|||. +++|+.. +|+.
T Consensus 396 ~--------------------~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~-~~~~~~ve~YDP~--td~W~~v~~m~~ 452 (557)
T PHA02713 396 V--------------------LDQYIYIIGGRTEHIDYTSVHHMNSIDMEED-THSSNKVIRYDTV--NNIWETLPNFWT 452 (557)
T ss_pred E--------------------ECCEEEEEeCCCccccccccccccccccccc-ccccceEEEECCC--CCeEeecCCCCc
Confidence 3 489999999975210 00000 00 00 0126789999997 5999986 9999
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCC-CcEeecCCCCccccccccceecCCCEEEEecCCC
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKI-NRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNP 414 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t-~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~ 414 (526)
+|..++++++ +|+|||+||.+ +.. .-...+|+|||++ ++|+.+++|+.+|..|+++++ ||+|||+||..
T Consensus 453 ~r~~~~~~~~-~~~IYv~GG~~-~~~------~~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~~~~--~~~iyv~Gg~~ 522 (557)
T PHA02713 453 GTIRPGVVSH-KDDIYVVCDIK-DEK------NVKTCIFRYNTNTYNGWELITTTESRLSALHTILH--DNTIMMLHCYE 522 (557)
T ss_pred ccccCcEEEE-CCEEEEEeCCC-CCC------ccceeEEEecCCCCCCeeEccccCcccccceeEEE--CCEEEEEeeec
Confidence 9999887776 99999999975 211 1123579999999 899999999999999998888 99999999964
Q ss_pred CCCCCcCCCCCCceeeEEEcCcc
Q 043369 415 NVNYNFSALFPTELSLQAFYPPY 437 (526)
Q Consensus 415 ~~~~~~~~~~p~~~~vE~y~Ppy 437 (526)
.. ..+|+|+|..
T Consensus 523 ~~-----------~~~e~yd~~~ 534 (557)
T PHA02713 523 SY-----------MLQDTFNVYT 534 (557)
T ss_pred ce-----------eehhhcCccc
Confidence 31 2689998876
No 6
>TIGR03547 muta_rot_YjhT mutatrotase, YjhT family. Members of this protein family contain multiple copies of the beta-propeller-forming Kelch repeat. All are full-length homologs to YjhT of Escherichia coli, which has been identified as a mutarotase for sialic acid. This protein improves bacterial ability to obtain host sialic acid, and thus serves as a virulence factor. Some bacteria carry what appears to be a cyclically permuted homolog of this protein.
Probab=99.97 E-value=9.6e-30 Score=263.62 Aligned_cols=250 Identities=14% Similarity=0.111 Sum_probs=176.4
Q ss_pred cceEcCCCcEEEEcCCCCCccEEEEEcC--CCCCCcccccCCCCC-cccccceeEEecCCcEEEEcCccC----------
Q 043369 110 SGALLANGVLVQTGGYRLGERVVRYLKP--CSDCDWEEDHQNGLI-SPRWYASNQILPNGKIIVVGGRFQ---------- 176 (526)
Q Consensus 110 ~~~~l~~G~l~v~GG~~~g~~~v~~ydp--~~t~~W~~~~~~~m~-~~R~y~s~~~L~dG~v~viGG~~~---------- 176 (526)
+.+++.+++|||+||.. .+.+.+||+ . +++|.++ ++|+ .+|.+++++++ |++|||+||...
T Consensus 11 ~~~~~~~~~vyv~GG~~--~~~~~~~d~~~~-~~~W~~l--~~~p~~~R~~~~~~~~-~~~iYv~GG~~~~~~~~~~~~~ 84 (346)
T TIGR03547 11 GTGAIIGDKVYVGLGSA--GTSWYKLDLKKP-SKGWQKI--ADFPGGPRNQAVAAAI-DGKLYVFGGIGKANSEGSPQVF 84 (346)
T ss_pred ceEEEECCEEEEEcccc--CCeeEEEECCCC-CCCceEC--CCCCCCCcccceEEEE-CCEEEEEeCCCCCCCCCcceec
Confidence 34667799999999974 367889996 4 6889999 5898 58998988888 899999999742
Q ss_pred CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEE-ecCCcEEEEEcc------------------------
Q 043369 177 FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHL-STDGNLFIFAND------------------------ 230 (526)
Q Consensus 177 ~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~-~~dG~Iy~~Gg~------------------------ 230 (526)
..+|+| |.++ +|..++.+..+ ..+.++.+ +.+|+||++||.
T Consensus 85 ~~v~~Yd~~~~-----~W~~~~~~~p~--------~~~~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~~~~~ 151 (346)
T TIGR03547 85 DDVYRYDPKKN-----SWQKLDTRSPV--------GLLGASGFSLHNGQAYFTGGVNKNIFDGYFADLSAADKDSEPKDK 151 (346)
T ss_pred ccEEEEECCCC-----EEecCCCCCCC--------cccceeEEEEeCCEEEEEcCcChHHHHHHHhhHhhcCccchhhhh
Confidence 358899 8887 78766422111 12233333 579999999984
Q ss_pred -----------------ceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEc
Q 043369 231 -----------------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICG 293 (526)
Q Consensus 231 -----------------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~G 293 (526)
++|+|||.+++|. .+++||.. +|.. ++.++ .+++||++|
T Consensus 152 ~~~~~~~~~~~~~~~~~~v~~YDp~t~~W~-~~~~~p~~-~r~~--~~~~~--------------------~~~~iyv~G 207 (346)
T TIGR03547 152 LIAAYFSQPPEDYFWNKNVLSYDPSTNQWR-NLGENPFL-GTAG--SAIVH--------------------KGNKLLLIN 207 (346)
T ss_pred hHHHHhCCChhHcCccceEEEEECCCCcee-ECccCCCC-cCCC--ceEEE--------------------ECCEEEEEe
Confidence 3689999999998 57766642 3432 22222 489999999
Q ss_pred CCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCcccc-------ccceEEeCCCcEEEEcCcCCCCC----
Q 043369 294 GTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRV-------MGDMILLPTGDVLIINGAAKGTA---- 361 (526)
Q Consensus 294 G~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~-------~~~~vvLpdG~V~vvGG~~~g~~---- 361 (526)
|..... ..+..+++||+....++|+.. +|+.+|. .+.+++ .+|+|||+||.+....
T Consensus 208 G~~~~~-----------~~~~~~~~y~~~~~~~~W~~~~~m~~~r~~~~~~~~~~~a~~-~~~~Iyv~GG~~~~~~~~~~ 275 (346)
T TIGR03547 208 GEIKPG-----------LRTAEVKQYLFTGGKLEWNKLPPLPPPKSSSQEGLAGAFAGI-SNGVLLVAGGANFPGAQENY 275 (346)
T ss_pred eeeCCC-----------ccchheEEEEecCCCceeeecCCCCCCCCCccccccEEeeeE-ECCEEEEeecCCCCCchhhh
Confidence 974211 112345667764335799986 9988763 233444 4999999999752100
Q ss_pred ----CccC-CCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCC
Q 043369 362 ----GWGA-AREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 362 ----g~~~-~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
.+.. ....+.++|+|||++++|+.+++|+.+|.+|+++++ +|+|||+||....
T Consensus 276 ~~~~~~~~~~~~~~~~~e~yd~~~~~W~~~~~lp~~~~~~~~~~~--~~~iyv~GG~~~~ 333 (346)
T TIGR03547 276 KNGKLYAHEGLIKAWSSEVYALDNGKWSKVGKLPQGLAYGVSVSW--NNGVLLIGGENSG 333 (346)
T ss_pred hcCCccccCCCCceeEeeEEEecCCcccccCCCCCCceeeEEEEc--CCEEEEEeccCCC
Confidence 0000 011224689999999999999999999998876555 9999999997543
No 7
>PRK14131 N-acetylneuraminic acid mutarotase; Provisional
Probab=99.96 E-value=6.6e-28 Score=252.64 Aligned_cols=277 Identities=17% Similarity=0.165 Sum_probs=183.6
Q ss_pred EeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCC-cccccceeEEecCCcEEEEcCcc
Q 043369 98 RPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLI-SPRWYASNQILPNGKIIVVGGRF 175 (526)
Q Consensus 98 ~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~-~~R~y~s~~~L~dG~v~viGG~~ 175 (526)
+.++.++..+-...++..+++||++||.. .+.+.+||+.. +++|..+ .+|+ .+|..++++++ +++|||+||..
T Consensus 20 ~~l~~lP~~~~~~~~~~~~~~iyv~gG~~--~~~~~~~d~~~~~~~W~~l--~~~p~~~r~~~~~v~~-~~~IYV~GG~~ 94 (376)
T PRK14131 20 EQLPDLPVPFKNGTGAIDNNTVYVGLGSA--GTSWYKLDLNAPSKGWTKI--AAFPGGPREQAVAAFI-DGKLYVFGGIG 94 (376)
T ss_pred ccCCCCCcCccCCeEEEECCEEEEEeCCC--CCeEEEEECCCCCCCeEEC--CcCCCCCcccceEEEE-CCEEEEEcCCC
Confidence 34444443332234566799999999973 25678898752 4789998 5786 58988888888 89999999975
Q ss_pred C----------CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEe-cCCcEEEEEcc-------------
Q 043369 176 Q----------FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLS-TDGNLFIFAND------------- 230 (526)
Q Consensus 176 ~----------~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~-~dG~Iy~~Gg~------------- 230 (526)
. ..+++| |.++ +|..++.+.. ...+.++.++ .+++||++||.
T Consensus 95 ~~~~~~~~~~~~~v~~YD~~~n-----~W~~~~~~~p--------~~~~~~~~~~~~~~~IYv~GG~~~~~~~~~~~d~~ 161 (376)
T PRK14131 95 KTNSEGSPQVFDDVYKYDPKTN-----SWQKLDTRSP--------VGLAGHVAVSLHNGKAYITGGVNKNIFDGYFEDLA 161 (376)
T ss_pred CCCCCCceeEcccEEEEeCCCC-----EEEeCCCCCC--------CcccceEEEEeeCCEEEEECCCCHHHHHHHHhhhh
Confidence 3 257889 8877 7877653211 1112233333 79999999993
Q ss_pred ----------------------------ceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCC
Q 043369 231 ----------------------------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNK 282 (526)
Q Consensus 231 ----------------------------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~ 282 (526)
++++||+.+++|. .++++|.. +|. +.++..
T Consensus 162 ~~~~~~~~~~~i~~~~~~~~~~~~~~~~~v~~YD~~t~~W~-~~~~~p~~-~~~----~~a~v~---------------- 219 (376)
T PRK14131 162 AAGKDKTPKDKINDAYFDKKPEDYFFNKEVLSYDPSTNQWK-NAGESPFL-GTA----GSAVVI---------------- 219 (376)
T ss_pred hcccchhhhhhhHHHHhcCChhhcCcCceEEEEECCCCeee-ECCcCCCC-CCC----cceEEE----------------
Confidence 3689999999998 57766642 232 222211
Q ss_pred CccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccccc-------cceEEeCCCcEEEEc
Q 043369 283 PVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRVM-------GDMILLPTGDVLIIN 354 (526)
Q Consensus 283 ~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~-------~~~vvLpdG~V~vvG 354 (526)
.+++||++||..... .....+..+++....++|+.. +|+.+|.. +.++++.+|+|||+|
T Consensus 220 --~~~~iYv~GG~~~~~-----------~~~~~~~~~~~~~~~~~W~~~~~~p~~~~~~~~~~~~~~~a~~~~~~iyv~G 286 (376)
T PRK14131 220 --KGNKLWLINGEIKPG-----------LRTDAVKQGKFTGNNLKWQKLPDLPPAPGGSSQEGVAGAFAGYSNGVLLVAG 286 (376)
T ss_pred --ECCEEEEEeeeECCC-----------cCChhheEEEecCCCcceeecCCCCCCCcCCcCCccceEeceeECCEEEEee
Confidence 489999999964211 112223333332235899986 89887742 121334599999999
Q ss_pred CcCCCCC------C--cc-CCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCCCCCcCCCCC
Q 043369 355 GAAKGTA------G--WG-AAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNVNYNFSALFP 425 (526)
Q Consensus 355 G~~~g~~------g--~~-~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~~~~~~~~~p 425 (526)
|...... + +. .....+.++|+|||++++|+.+++|+.+|.+|+++++ +|+|||+||......
T Consensus 287 G~~~~~~~~~~~~~~~~~~~~~~~~~~~e~yd~~~~~W~~~~~lp~~r~~~~av~~--~~~iyv~GG~~~~~~------- 357 (376)
T PRK14131 287 GANFPGARENYQNGKLYAHEGLKKSWSDEIYALVNGKWQKVGELPQGLAYGVSVSW--NNGVLLIGGETAGGK------- 357 (376)
T ss_pred ccCCCCChhhhhcCCcccccCCcceeehheEEecCCcccccCcCCCCccceEEEEe--CCEEEEEcCCCCCCc-------
Confidence 9752100 0 00 0011234689999999999999999999999976555 999999999654321
Q ss_pred CceeeEEEcCc
Q 043369 426 TELSLQAFYPP 436 (526)
Q Consensus 426 ~~~~vE~y~Pp 436 (526)
...+|++|.|.
T Consensus 358 ~~~~v~~~~~~ 368 (376)
T PRK14131 358 AVSDVTLLSWD 368 (376)
T ss_pred EeeeEEEEEEc
Confidence 13478888775
No 8
>PHA02790 Kelch-like protein; Provisional
Probab=99.96 E-value=8.2e-28 Score=259.29 Aligned_cols=218 Identities=16% Similarity=0.184 Sum_probs=167.4
Q ss_pred EeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCC--CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCc
Q 043369 90 FDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRL--GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGK 167 (526)
Q Consensus 90 yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~--g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~ 167 (526)
|++.+++|.... ..| .++..++.||++||... ..+.++.|||. +++|... ++|+.+|.+++++++ ||+
T Consensus 251 ~~~~~~~~~~~~----~~~--~~~~~~~~lyviGG~~~~~~~~~v~~Ydp~-~~~W~~~--~~m~~~r~~~~~v~~-~~~ 320 (480)
T PHA02790 251 YPMNMDQIIDIF----HMC--TSTHVGEVVYLIGGWMNNEIHNNAIAVNYI-SNNWIPI--PPMNSPRLYASGVPA-NNK 320 (480)
T ss_pred cCCcccceeecc----CCc--ceEEECCEEEEEcCCCCCCcCCeEEEEECC-CCEEEEC--CCCCchhhcceEEEE-CCE
Confidence 456666676532 122 23447889999999753 24689999999 9999999 689999999998888 899
Q ss_pred EEEEcCccC-CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-----ceEEEeccCC
Q 043369 168 IIVVGGRFQ-FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-----RAILLDYVNN 240 (526)
Q Consensus 168 v~viGG~~~-~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-----~~~~yDp~t~ 240 (526)
||++||.+. .++|.| |.++ +|..++.|...+ +-++.+..+|+||++||. .+++|||.++
T Consensus 321 iYviGG~~~~~sve~ydp~~n-----~W~~~~~l~~~r---------~~~~~~~~~g~IYviGG~~~~~~~ve~ydp~~~ 386 (480)
T PHA02790 321 LYVVGGLPNPTSVERWFHGDA-----AWVNMPSLLKPR---------CNPAVASINNVIYVIGGHSETDTTTEYLLPNHD 386 (480)
T ss_pred EEEECCcCCCCceEEEECCCC-----eEEECCCCCCCC---------cccEEEEECCEEEEecCcCCCCccEEEEeCCCC
Confidence 999999854 578999 8877 788765554321 124556779999999994 4789999999
Q ss_pred eEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEE
Q 043369 241 RVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLT 320 (526)
Q Consensus 241 ~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d 320 (526)
+|. ..|+||. +|.. +++++ .+++||++||. +|+||
T Consensus 387 ~W~-~~~~m~~--~r~~--~~~~~--------------------~~~~IYv~GG~--------------------~e~yd 421 (480)
T PHA02790 387 QWQ-FGPSTYY--PHYK--SCALV--------------------FGRRLFLVGRN--------------------AEFYC 421 (480)
T ss_pred EEE-eCCCCCC--cccc--ceEEE--------------------ECCEEEEECCc--------------------eEEec
Confidence 998 5776665 4653 23333 48999999983 36799
Q ss_pred eecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecC
Q 043369 321 ITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILS 387 (526)
Q Consensus 321 ~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a 387 (526)
|. +++|+.. +|+.+|..++++++ +|+|||+||.+.+ ....++|+|||++++|+.+.
T Consensus 422 p~--~~~W~~~~~m~~~r~~~~~~v~-~~~IYviGG~~~~--------~~~~~ve~Yd~~~~~W~~~~ 478 (480)
T PHA02790 422 ES--SNTWTLIDDPIYPRDNPELIIV-DNKLLLIGGFYRG--------SYIDTIEVYNNRTYSWNIWD 478 (480)
T ss_pred CC--CCcEeEcCCCCCCccccEEEEE-CCEEEEECCcCCC--------cccceEEEEECCCCeEEecC
Confidence 86 6999986 99999999887776 9999999997621 12347999999999998763
No 9
>PLN02153 epithiospecifier protein
Probab=99.95 E-value=1.7e-26 Score=238.88 Aligned_cols=282 Identities=13% Similarity=0.094 Sum_probs=188.7
Q ss_pred CCCCcEEeCcc----CCccccccceEcCCCcEEEEcCCCCC----ccEEEEEcCCCCCCcccccCCCCC-cccc---cce
Q 043369 92 PITRKVRPLTI----QTDTWCSSGALLANGVLVQTGGYRLG----ERVVRYLKPCSDCDWEEDHQNGLI-SPRW---YAS 159 (526)
Q Consensus 92 p~t~~w~~~~~----~~~~fc~~~~~l~~G~l~v~GG~~~g----~~~v~~ydp~~t~~W~~~~~~~m~-~~R~---y~s 159 (526)
|...+|+.+.. .+..++..+++..+++|||+||.... .+.+++||+. +++|+.. .+|. .+|. .++
T Consensus 4 ~~~~~W~~~~~~~~~~P~pR~~h~~~~~~~~iyv~GG~~~~~~~~~~~~~~yd~~-~~~W~~~--~~~~~~p~~~~~~~~ 80 (341)
T PLN02153 4 TLQGGWIKVEQKGGKGPGPRCSHGIAVVGDKLYSFGGELKPNEHIDKDLYVFDFN-THTWSIA--PANGDVPRISCLGVR 80 (341)
T ss_pred ccCCeEEEecCCCCCCCCCCCcceEEEECCEEEEECCccCCCCceeCcEEEEECC-CCEEEEc--CccCCCCCCccCceE
Confidence 35667988865 34556666677779999999997421 3579999999 9999987 3443 4543 466
Q ss_pred eEEecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc----
Q 043369 160 NQILPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND---- 230 (526)
Q Consensus 160 ~~~L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~---- 230 (526)
++++ +++|||+||.+. ..+++| |.++ +|..++.+.+.. .+...+-++.++.+++||++||.
T Consensus 81 ~~~~-~~~iyv~GG~~~~~~~~~v~~yd~~t~-----~W~~~~~~~~~~----~p~~R~~~~~~~~~~~iyv~GG~~~~~ 150 (341)
T PLN02153 81 MVAV-GTKLYIFGGRDEKREFSDFYSYDTVKN-----EWTFLTKLDEEG----GPEARTFHSMASDENHVYVFGGVSKGG 150 (341)
T ss_pred EEEE-CCEEEEECCCCCCCccCcEEEEECCCC-----EEEEeccCCCCC----CCCCceeeEEEEECCEEEEECCccCCC
Confidence 6777 899999999753 358899 8877 787664331100 01122335567779999999994
Q ss_pred ---------ceEEEeccCCeEEEeccCCCCC-CCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCC
Q 043369 231 ---------RAILLDYVNNRVMKNYPVMPGG-ISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSN 300 (526)
Q Consensus 231 ---------~~~~yDp~t~~w~~~~p~~p~~-~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~ 300 (526)
+.++||+++++|. .++.+... .+|.. ++.++ .+++||++||... .+
T Consensus 151 ~~~~~~~~~~v~~yd~~~~~W~-~l~~~~~~~~~r~~--~~~~~--------------------~~~~iyv~GG~~~-~~ 206 (341)
T PLN02153 151 LMKTPERFRTIEAYNIADGKWV-QLPDPGENFEKRGG--AGFAV--------------------VQGKIWVVYGFAT-SI 206 (341)
T ss_pred ccCCCcccceEEEEECCCCeEe-eCCCCCCCCCCCCc--ceEEE--------------------ECCeEEEEecccc-cc
Confidence 3578999999998 46654311 23432 22222 4899999999642 11
Q ss_pred chhhhhhcccccccceEEEEeecCCCCceec----ccCccccccceEEeCCCcEEEEcCcCCCC-CCccCCCCCccccEE
Q 043369 301 ENAAEAQIFLPAAKSCGRLTITAQNPKWEME----EMPLNRVMGDMILLPTGDVLIINGAAKGT-AGWGAAREPVLNPVI 375 (526)
Q Consensus 301 ~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~----~M~~~R~~~~~vvLpdG~V~vvGG~~~g~-~g~~~~~~~~~~~e~ 375 (526)
...+ .. ...++.+++||+. +++|+.. .||.+|..++++++ +++|||+||..... .+..........+++
T Consensus 207 ~~gG--~~-~~~~~~v~~yd~~--~~~W~~~~~~g~~P~~r~~~~~~~~-~~~iyv~GG~~~~~~~~~~~~~~~~n~v~~ 280 (341)
T PLN02153 207 LPGG--KS-DYESNAVQFFDPA--SGKWTEVETTGAKPSARSVFAHAVV-GKYIIIFGGEVWPDLKGHLGPGTLSNEGYA 280 (341)
T ss_pred ccCC--cc-ceecCceEEEEcC--CCcEEeccccCCCCCCcceeeeEEE-CCEEEEECcccCCccccccccccccccEEE
Confidence 0000 00 1125679999986 5999974 47889998887665 99999999974110 000000111236899
Q ss_pred EeCCCCcEeecC-----CCCccccccccceecCCCEEEEecCCCCC
Q 043369 376 YCPKINRFRILS-----PSLIPRLYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 376 YDP~t~~Wt~~a-----~~~~~R~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
|||++++|+.+. +++..|.+|+++++.-+++||+.||....
T Consensus 281 ~d~~~~~W~~~~~~~~~~~pr~~~~~~~~~v~~~~~~~~~gG~~~~ 326 (341)
T PLN02153 281 LDTETLVWEKLGECGEPAMPRGWTAYTTATVYGKNGLLMHGGKLPT 326 (341)
T ss_pred EEcCccEEEeccCCCCCCCCCccccccccccCCcceEEEEcCcCCC
Confidence 999999999885 56666766677776556799999997543
No 10
>PRK14131 N-acetylneuraminic acid mutarotase; Provisional
Probab=99.95 E-value=8.4e-26 Score=236.71 Aligned_cols=285 Identities=15% Similarity=0.095 Sum_probs=188.7
Q ss_pred cEEEcccCCccceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCC--CCcEEeCccCC-c
Q 043369 29 KWKLLKRSIGVSAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPI--TRKVRPLTIQT-D 105 (526)
Q Consensus 29 ~W~~~~~~~~v~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~--t~~w~~~~~~~-~ 105 (526)
.++.+++++.-..-+++...+++||+++|... .....||+. +++|++++.++ .
T Consensus 18 ~~~~l~~lP~~~~~~~~~~~~~~iyv~gG~~~------------------------~~~~~~d~~~~~~~W~~l~~~p~~ 73 (376)
T PRK14131 18 NAEQLPDLPVPFKNGTGAIDNNTVYVGLGSAG------------------------TSWYKLDLNAPSKGWTKIAAFPGG 73 (376)
T ss_pred ecccCCCCCcCccCCeEEEECCEEEEEeCCCC------------------------CeEEEEECCCCCCCeEECCcCCCC
Confidence 44555544322222345567999999988631 124567775 57899998764 3
Q ss_pred cccccceEcCCCcEEEEcCCCC----C----ccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC-
Q 043369 106 TWCSSGALLANGVLVQTGGYRL----G----ERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ- 176 (526)
Q Consensus 106 ~fc~~~~~l~~G~l~v~GG~~~----g----~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~- 176 (526)
.++..+++..+++||++||... + .+.+++|||. +++|... +..++.+|..++++++.|++|||+||.+.
T Consensus 74 ~r~~~~~v~~~~~IYV~GG~~~~~~~~~~~~~~~v~~YD~~-~n~W~~~-~~~~p~~~~~~~~~~~~~~~IYv~GG~~~~ 151 (376)
T PRK14131 74 PREQAVAAFIDGKLYVFGGIGKTNSEGSPQVFDDVYKYDPK-TNSWQKL-DTRSPVGLAGHVAVSLHNGKAYITGGVNKN 151 (376)
T ss_pred CcccceEEEECCEEEEEcCCCCCCCCCceeEcccEEEEeCC-CCEEEeC-CCCCCCcccceEEEEeeCCEEEEECCCCHH
Confidence 5666667788999999999753 1 3679999999 9999998 22346667777777645999999999642
Q ss_pred -------------------------------------CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEE
Q 043369 177 -------------------------------------FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHL 218 (526)
Q Consensus 177 -------------------------------------~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~ 218 (526)
..+++| |.++ +|..++.+.... ...++++
T Consensus 152 ~~~~~~~d~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~v~~YD~~t~-----~W~~~~~~p~~~--------~~~~a~v 218 (376)
T PRK14131 152 IFDGYFEDLAAAGKDKTPKDKINDAYFDKKPEDYFFNKEVLSYDPSTN-----QWKNAGESPFLG--------TAGSAVV 218 (376)
T ss_pred HHHHHHhhhhhcccchhhhhhhHHHHhcCChhhcCcCceEEEEECCCC-----eeeECCcCCCCC--------CCcceEE
Confidence 358899 9887 787664332211 1224556
Q ss_pred ecCCcEEEEEccc------eE----EEeccCCeEEEeccCCCCCCCCccC--C--CCc-eeecccccccccccccCCCCC
Q 043369 219 STDGNLFIFANDR------AI----LLDYVNNRVMKNYPVMPGGISRNYP--S--TGS-SVLLPVNLSSINVHINNNNKP 283 (526)
Q Consensus 219 ~~dG~Iy~~Gg~~------~~----~yDp~t~~w~~~~p~~p~~~~r~y~--~--~g~-~v~lp~~~~~~~~~~~~~~~~ 283 (526)
..+++||++||.. .+ .||+++++|. .++.+|.. |..+ . .+. +++
T Consensus 219 ~~~~~iYv~GG~~~~~~~~~~~~~~~~~~~~~~W~-~~~~~p~~--~~~~~~~~~~~~~a~~------------------ 277 (376)
T PRK14131 219 IKGNKLWLINGEIKPGLRTDAVKQGKFTGNNLKWQ-KLPDLPPA--PGGSSQEGVAGAFAGY------------------ 277 (376)
T ss_pred EECCEEEEEeeeECCCcCChhheEEEecCCCccee-ecCCCCCC--CcCCcCCccceEecee------------------
Confidence 6799999999942 22 3578889998 57767653 4211 0 111 121
Q ss_pred ccCcEEEEEcCCCCCCCchh--hhhh-cc---cccccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCc
Q 043369 284 VVHSQVLICGGTLPDSNENA--AEAQ-IF---LPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGA 356 (526)
Q Consensus 284 ~~~gkI~v~GG~~~~~~~~~--~~~~-~~---~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~ 356 (526)
.+++||++||.... .... .++. +. .....++|+||+. +++|+.. +||.+|.++.++++ +|+|||+||.
T Consensus 278 -~~~~iyv~GG~~~~-~~~~~~~~~~~~~~~~~~~~~~~e~yd~~--~~~W~~~~~lp~~r~~~~av~~-~~~iyv~GG~ 352 (376)
T PRK14131 278 -SNGVLLVAGGANFP-GARENYQNGKLYAHEGLKKSWSDEIYALV--NGKWQKVGELPQGLAYGVSVSW-NNGVLLIGGE 352 (376)
T ss_pred -ECCEEEEeeccCCC-CChhhhhcCCcccccCCcceeehheEEec--CCcccccCcCCCCccceEEEEe-CCEEEEEcCC
Confidence 48999999997521 1000 0000 00 0112357899986 5899986 99999998876655 9999999997
Q ss_pred CCCCCCccCCCCCccccEEEeCCCCcEee
Q 043369 357 AKGTAGWGAAREPVLNPVIYCPKINRFRI 385 (526)
Q Consensus 357 ~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~ 385 (526)
..+ ...+..+++|+|+.++++.
T Consensus 353 ~~~-------~~~~~~v~~~~~~~~~~~~ 374 (376)
T PRK14131 353 TAG-------GKAVSDVTLLSWDGKKLTV 374 (376)
T ss_pred CCC-------CcEeeeEEEEEEcCCEEEE
Confidence 521 1245578999999887764
No 11
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=99.94 E-value=6.5e-26 Score=232.82 Aligned_cols=252 Identities=15% Similarity=0.163 Sum_probs=171.5
Q ss_pred ceEcCCCcEEEEcCCCCCc------------cEEEEE-cCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC-
Q 043369 111 GALLANGVLVQTGGYRLGE------------RVVRYL-KPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ- 176 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~------------~~v~~y-dp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~- 176 (526)
.+...++.||++||..... +.+.+| |+..+.+|... .+|+.+|.+++++++ +++||++||.+.
T Consensus 8 ~~~~~~~~l~v~GG~~~~~~~~~~~g~~~~~~~v~~~~~~~~~~~W~~~--~~lp~~r~~~~~~~~-~~~lyviGG~~~~ 84 (323)
T TIGR03548 8 YAGIIGDYILVAGGCNFPEDPLAEGGKKKNYKGIYIAKDENSNLKWVKD--GQLPYEAAYGASVSV-ENGIYYIGGSNSS 84 (323)
T ss_pred eeeEECCEEEEeeccCCCCCchhhCCcEEeeeeeEEEecCCCceeEEEc--ccCCccccceEEEEE-CCEEEEEcCCCCC
Confidence 3456789999999974210 234445 44312379998 689999988888888 899999999764
Q ss_pred ---CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------ceEEEeccCCeEEEe
Q 043369 177 ---FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-------RAILLDYVNNRVMKN 245 (526)
Q Consensus 177 ---~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-------~~~~yDp~t~~w~~~ 245 (526)
..++.| +.++.|. ..|..++.++..+ .-+..++.+++||++||. +.++||+++++|. .
T Consensus 85 ~~~~~v~~~d~~~~~w~-~~~~~~~~lp~~~---------~~~~~~~~~~~iYv~GG~~~~~~~~~v~~yd~~~~~W~-~ 153 (323)
T TIGR03548 85 ERFSSVYRITLDESKEE-LICETIGNLPFTF---------ENGSACYKDGTLYVGGGNRNGKPSNKSYLFNLETQEWF-E 153 (323)
T ss_pred CCceeEEEEEEcCCcee-eeeeEcCCCCcCc---------cCceEEEECCEEEEEeCcCCCccCceEEEEcCCCCCee-E
Confidence 357888 7766331 1245554443221 124556679999999994 4799999999998 5
Q ss_pred ccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCC
Q 043369 246 YPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQN 325 (526)
Q Consensus 246 ~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~ 325 (526)
++++|.. +|.. ..++. .+++||++||.+.. ....+++||+. +
T Consensus 154 ~~~~p~~-~r~~---~~~~~-------------------~~~~iYv~GG~~~~-------------~~~~~~~yd~~--~ 195 (323)
T TIGR03548 154 LPDFPGE-PRVQ---PVCVK-------------------LQNELYVFGGGSNI-------------AYTDGYKYSPK--K 195 (323)
T ss_pred CCCCCCC-CCCc---ceEEE-------------------ECCEEEEEcCCCCc-------------cccceEEEecC--C
Confidence 7766653 3542 22222 48999999997521 12356899987 5
Q ss_pred CCceec-ccC---ccc--cccceEEeCCCcEEEEcCcCCCCC-----CccC-----------------CCC--CccccEE
Q 043369 326 PKWEME-EMP---LNR--VMGDMILLPTGDVLIINGAAKGTA-----GWGA-----------------ARE--PVLNPVI 375 (526)
Q Consensus 326 ~~W~~~-~M~---~~R--~~~~~vvLpdG~V~vvGG~~~g~~-----g~~~-----------------~~~--~~~~~e~ 375 (526)
++|+.. +|+ .+| ..+.++++.+++|||+||.+.... .+.. .+. -..++|+
T Consensus 196 ~~W~~~~~~~~~~~p~~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~ 275 (323)
T TIGR03548 196 NQWQKVADPTTDSEPISLLGAASIKINESLLLCIGGFNKDVYNDAVIDLATMKDESLKGYKKEYFLKPPEWYNWNRKILI 275 (323)
T ss_pred CeeEECCCCCCCCCceeccceeEEEECCCEEEEECCcCHHHHHHHHhhhhhccchhhhhhHHHHhCCCccccCcCceEEE
Confidence 899986 663 333 334445556899999999762100 0000 000 1236899
Q ss_pred EeCCCCcEeecCCCC-ccccccccceecCCCEEEEecCCCCC
Q 043369 376 YCPKINRFRILSPSL-IPRLYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 376 YDP~t~~Wt~~a~~~-~~R~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
|||.+++|+.+++++ .+|..|+++++ |++||++||+...
T Consensus 276 yd~~~~~W~~~~~~p~~~r~~~~~~~~--~~~iyv~GG~~~p 315 (323)
T TIGR03548 276 YNVRTGKWKSIGNSPFFARCGAALLLT--GNNIFSINGELKP 315 (323)
T ss_pred EECCCCeeeEcccccccccCchheEEE--CCEEEEEeccccC
Confidence 999999999999887 58988887666 9999999997544
No 12
>PHA03098 kelch-like protein; Provisional
Probab=99.94 E-value=6.7e-26 Score=248.21 Aligned_cols=244 Identities=16% Similarity=0.217 Sum_probs=184.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCC---ccEEEEEcCCCCCCcccccCCCCCcccccceeEE
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLG---ERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQI 162 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g---~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~ 162 (526)
....|++.+++|.++...+...|. +++..+++||++||.... .+.+..|||. +++|... .+|+.+|.++++++
T Consensus 265 ~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~lyv~GG~~~~~~~~~~v~~yd~~-~~~W~~~--~~~~~~R~~~~~~~ 340 (534)
T PHA03098 265 NYITNYSPLSEINTIIDIHYVYCF-GSVVLNNVIYFIGGMNKNNLSVNSVVSYDTK-TKSWNKV--PELIYPRKNPGVTV 340 (534)
T ss_pred eeeecchhhhhcccccCccccccc-eEEEECCEEEEECCCcCCCCeeccEEEEeCC-CCeeeEC--CCCCcccccceEEE
Confidence 356789989999998765544453 567789999999998532 3578999999 9999998 58999999999888
Q ss_pred ecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------
Q 043369 163 LPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND------- 230 (526)
Q Consensus 163 L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~------- 230 (526)
+ +|+||++||.+. .++|+| |.++ +|...+.+... .+.++.+..+|+||++||.
T Consensus 341 ~-~~~lyv~GG~~~~~~~~~v~~yd~~~~-----~W~~~~~lp~~---------r~~~~~~~~~~~iYv~GG~~~~~~~~ 405 (534)
T PHA03098 341 F-NNRIYVIGGIYNSISLNTVESWKPGES-----KWREEPPLIFP---------RYNPCVVNVNNLIYVIGGISKNDELL 405 (534)
T ss_pred E-CCEEEEEeCCCCCEecceEEEEcCCCC-----ceeeCCCcCcC---------CccceEEEECCEEEEECCcCCCCccc
Confidence 8 899999999863 368999 8887 78765433221 2334556779999999993
Q ss_pred -ceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcc
Q 043369 231 -RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIF 309 (526)
Q Consensus 231 -~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~ 309 (526)
++++||+.+++|. .++++|. +|.. ++++. .+++||++||......
T Consensus 406 ~~v~~yd~~t~~W~-~~~~~p~--~r~~---~~~~~-------------------~~~~iyv~GG~~~~~~--------- 451 (534)
T PHA03098 406 KTVECFSLNTNKWS-KGSPLPI--SHYG---GCAIY-------------------HDGKIYVIGGISYIDN--------- 451 (534)
T ss_pred ceEEEEeCCCCeee-ecCCCCc--cccC---ceEEE-------------------ECCEEEEECCccCCCC---------
Confidence 4799999999998 5776665 3542 22222 4899999999752110
Q ss_pred cccccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCC
Q 043369 310 LPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSP 388 (526)
Q Consensus 310 ~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~ 388 (526)
....+.+++||+. +++|+.. +|+.+|..++++++ +|+|||+||.... ....++|+|||++++|+.+..
T Consensus 452 ~~~~~~v~~yd~~--~~~W~~~~~~~~~r~~~~~~~~-~~~iyv~GG~~~~--------~~~~~v~~yd~~~~~W~~~~~ 520 (534)
T PHA03098 452 IKVYNIVESYNPV--TNKWTELSSLNFPRINASLCIF-NNKIYVVGGDKYE--------YYINEIEVYDDKTNTWTLFCK 520 (534)
T ss_pred CcccceEEEecCC--CCceeeCCCCCcccccceEEEE-CCEEEEEcCCcCC--------cccceeEEEeCCCCEEEecCC
Confidence 1124568999986 5999986 89999998887776 9999999997621 113478999999999999887
Q ss_pred CCccc
Q 043369 389 SLIPR 393 (526)
Q Consensus 389 ~~~~R 393 (526)
++...
T Consensus 521 ~p~~~ 525 (534)
T PHA03098 521 FPKVI 525 (534)
T ss_pred Ccccc
Confidence 65433
No 13
>TIGR03547 muta_rot_YjhT mutatrotase, YjhT family. Members of this protein family contain multiple copies of the beta-propeller-forming Kelch repeat. All are full-length homologs to YjhT of Escherichia coli, which has been identified as a mutarotase for sialic acid. This protein improves bacterial ability to obtain host sialic acid, and thus serves as a virulence factor. Some bacteria carry what appears to be a cyclically permuted homolog of this protein.
Probab=99.94 E-value=2.4e-25 Score=230.69 Aligned_cols=251 Identities=16% Similarity=0.093 Sum_probs=170.7
Q ss_pred EEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeC--CCCcEEeCccCC-ccccccceEcCCCcE
Q 043369 43 HMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDP--ITRKVRPLTIQT-DTWCSSGALLANGVL 119 (526)
Q Consensus 43 ~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp--~t~~w~~~~~~~-~~fc~~~~~l~~G~l 119 (526)
+++.+.+++||++||... .....||+ .+++|++++.++ ..++..+++..+++|
T Consensus 11 ~~~~~~~~~vyv~GG~~~------------------------~~~~~~d~~~~~~~W~~l~~~p~~~R~~~~~~~~~~~i 66 (346)
T TIGR03547 11 GTGAIIGDKVYVGLGSAG------------------------TSWYKLDLKKPSKGWQKIADFPGGPRNQAVAAAIDGKL 66 (346)
T ss_pred ceEEEECCEEEEEccccC------------------------CeeEEEECCCCCCCceECCCCCCCCcccceEEEECCEE
Confidence 445567999999998631 13557875 678999999876 467777788889999
Q ss_pred EEEcCCCC--------CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC---------------
Q 043369 120 VQTGGYRL--------GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ--------------- 176 (526)
Q Consensus 120 ~v~GG~~~--------g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~--------------- 176 (526)
|++||... ..+.+++|||. +++|+.. +..|+.+|..++++++.+|+|||+||.+.
T Consensus 67 Yv~GG~~~~~~~~~~~~~~~v~~Yd~~-~~~W~~~-~~~~p~~~~~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~ 144 (346)
T TIGR03547 67 YVFGGIGKANSEGSPQVFDDVYRYDPK-KNSWQKL-DTRSPVGLLGASGFSLHNGQAYFTGGVNKNIFDGYFADLSAADK 144 (346)
T ss_pred EEEeCCCCCCCCCcceecccEEEEECC-CCEEecC-CCCCCCcccceeEEEEeCCEEEEEcCcChHHHHHHHhhHhhcCc
Confidence 99999742 13679999999 9999998 22456667656665344999999999752
Q ss_pred -----------------------CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc-
Q 043369 177 -----------------------FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR- 231 (526)
Q Consensus 177 -----------------------~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~- 231 (526)
..+|+| |.++ +|..++.+.... .+-+.++..+++||++||..
T Consensus 145 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~YDp~t~-----~W~~~~~~p~~~--------r~~~~~~~~~~~iyv~GG~~~ 211 (346)
T TIGR03547 145 DSEPKDKLIAAYFSQPPEDYFWNKNVLSYDPSTN-----QWRNLGENPFLG--------TAGSAIVHKGNKLLLINGEIK 211 (346)
T ss_pred cchhhhhhHHHHhCCChhHcCccceEEEEECCCC-----ceeECccCCCCc--------CCCceEEEECCEEEEEeeeeC
Confidence 468999 9887 787664432211 12234566799999999942
Q ss_pred -------eEEEe--ccCCeEEEeccCCCCCCCCccCCC---Cc-eeecccccccccccccCCCCCccCcEEEEEcCCCCC
Q 043369 232 -------AILLD--YVNNRVMKNYPVMPGGISRNYPST---GS-SVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPD 298 (526)
Q Consensus 232 -------~~~yD--p~t~~w~~~~p~~p~~~~r~y~~~---g~-~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~ 298 (526)
.++|| +++++|. .+++||.. |..... +. ++. .+++||++||....
T Consensus 212 ~~~~~~~~~~y~~~~~~~~W~-~~~~m~~~--r~~~~~~~~~~~a~~-------------------~~~~Iyv~GG~~~~ 269 (346)
T TIGR03547 212 PGLRTAEVKQYLFTGGKLEWN-KLPPLPPP--KSSSQEGLAGAFAGI-------------------SNGVLLVAGGANFP 269 (346)
T ss_pred CCccchheEEEEecCCCceee-ecCCCCCC--CCCccccccEEeeeE-------------------ECCEEEEeecCCCC
Confidence 34565 4677998 57777653 421111 11 222 48999999997521
Q ss_pred CCchh--hhhhcc---cccccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcC
Q 043369 299 SNENA--AEAQIF---LPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAA 357 (526)
Q Consensus 299 ~~~~~--~~~~~~---~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~ 357 (526)
..... ....+. ...+.++|+||+. .++|+.. +||.+|..+.++++ +|+|||+||.+
T Consensus 270 ~~~~~~~~~~~~~~~~~~~~~~~e~yd~~--~~~W~~~~~lp~~~~~~~~~~~-~~~iyv~GG~~ 331 (346)
T TIGR03547 270 GAQENYKNGKLYAHEGLIKAWSSEVYALD--NGKWSKVGKLPQGLAYGVSVSW-NNGVLLIGGEN 331 (346)
T ss_pred CchhhhhcCCccccCCCCceeEeeEEEec--CCcccccCCCCCCceeeEEEEc-CCEEEEEeccC
Confidence 00000 000000 0113478999986 5899986 99999988775554 99999999976
No 14
>PHA02790 Kelch-like protein; Provisional
Probab=99.94 E-value=4.5e-26 Score=245.79 Aligned_cols=194 Identities=10% Similarity=0.196 Sum_probs=152.3
Q ss_pred EEecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc----c
Q 043369 161 QILPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND----R 231 (526)
Q Consensus 161 ~~L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~----~ 231 (526)
+.+ ++.||++||.+. .+++.| |.++ +|..++.|...+ . + +..+..+|+||++||. +
T Consensus 268 ~~~-~~~lyviGG~~~~~~~~~v~~Ydp~~~-----~W~~~~~m~~~r-------~-~-~~~v~~~~~iYviGG~~~~~s 332 (480)
T PHA02790 268 THV-GEVVYLIGGWMNNEIHNNAIAVNYISN-----NWIPIPPMNSPR-------L-Y-ASGVPANNKLYVVGGLPNPTS 332 (480)
T ss_pred EEE-CCEEEEEcCCCCCCcCCeEEEEECCCC-----EEEECCCCCchh-------h-c-ceEEEECCEEEEECCcCCCCc
Confidence 346 889999999753 368899 9887 788775543321 1 2 3345679999999994 4
Q ss_pred eEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccc
Q 043369 232 AILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLP 311 (526)
Q Consensus 232 ~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~ 311 (526)
+|+|||.+|+|. .+|+||. +|.. +++++ .+++||++||...
T Consensus 333 ve~ydp~~n~W~-~~~~l~~--~r~~--~~~~~--------------------~~g~IYviGG~~~-------------- 373 (480)
T PHA02790 333 VERWFHGDAAWV-NMPSLLK--PRCN--PAVAS--------------------INNVIYVIGGHSE-------------- 373 (480)
T ss_pred eEEEECCCCeEE-ECCCCCC--CCcc--cEEEE--------------------ECCEEEEecCcCC--------------
Confidence 799999999998 5887775 4653 23333 4999999999751
Q ss_pred cccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCC
Q 043369 312 AAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSL 390 (526)
Q Consensus 312 a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~ 390 (526)
..+++|+|||. +++|+.. +|+.+|..++++++ +|+|||+||. +|+|||++++|+.+++|+
T Consensus 374 ~~~~ve~ydp~--~~~W~~~~~m~~~r~~~~~~~~-~~~IYv~GG~----------------~e~ydp~~~~W~~~~~m~ 434 (480)
T PHA02790 374 TDTTTEYLLPN--HDQWQFGPSTYYPHYKSCALVF-GRRLFLVGRN----------------AEFYCESSNTWTLIDDPI 434 (480)
T ss_pred CCccEEEEeCC--CCEEEeCCCCCCccccceEEEE-CCEEEEECCc----------------eEEecCCCCcEeEcCCCC
Confidence 13578999986 5999987 99999999887766 9999999973 489999999999999999
Q ss_pred ccccccccceecCCCEEEEecCCCCCCCCcCCCCCCceeeEEEcCcc
Q 043369 391 IPRLYHSTAHLLSDGRVLVGGSNPNVNYNFSALFPTELSLQAFYPPY 437 (526)
Q Consensus 391 ~~R~yhs~a~LlpdG~V~v~GG~~~~~~~~~~~~p~~~~vE~y~Ppy 437 (526)
.+|..|+++++ +|+|||+||..... + ...+|+|+|..
T Consensus 435 ~~r~~~~~~v~--~~~IYviGG~~~~~------~--~~~ve~Yd~~~ 471 (480)
T PHA02790 435 YPRDNPELIIV--DNKLLLIGGFYRGS------Y--IDTIEVYNNRT 471 (480)
T ss_pred CCccccEEEEE--CCEEEEECCcCCCc------c--cceEEEEECCC
Confidence 99999998877 99999999965321 1 24799999974
No 15
>PLN02193 nitrile-specifier protein
Probab=99.94 E-value=9.1e-25 Score=235.06 Aligned_cols=276 Identities=12% Similarity=0.086 Sum_probs=187.9
Q ss_pred EEEeCCC----CcEEeCccC---CccccccceEcCCCcEEEEcCCCCC----ccEEEEEcCCCCCCcccccCC-CCCcc-
Q 043369 88 VEFDPIT----RKVRPLTIQ---TDTWCSSGALLANGVLVQTGGYRLG----ERVVRYLKPCSDCDWEEDHQN-GLISP- 154 (526)
Q Consensus 88 ~~yDp~t----~~w~~~~~~---~~~fc~~~~~l~~G~l~v~GG~~~g----~~~v~~ydp~~t~~W~~~~~~-~m~~~- 154 (526)
.++||.+ ++|..++.. +..++..+++..+++||++||.... .+.+++||+. +++|+..++. +++..
T Consensus 140 y~~~~~~~~~~~~W~~~~~~~~~P~pR~~h~~~~~~~~iyv~GG~~~~~~~~~~~v~~yD~~-~~~W~~~~~~g~~P~~~ 218 (470)
T PLN02193 140 YISLPSTPKLLGKWIKVEQKGEGPGLRCSHGIAQVGNKIYSFGGEFTPNQPIDKHLYVFDLE-TRTWSISPATGDVPHLS 218 (470)
T ss_pred EEecCCChhhhceEEEcccCCCCCCCccccEEEEECCEEEEECCcCCCCCCeeCcEEEEECC-CCEEEeCCCCCCCCCCc
Confidence 4457766 799988753 4567777788889999999997421 2468999999 9999986211 23332
Q ss_pred cccceeEEecCCcEEEEcCccC----CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEc
Q 043369 155 RWYASNQILPNGKIIVVGGRFQ----FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAN 229 (526)
Q Consensus 155 R~y~s~~~L~dG~v~viGG~~~----~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg 229 (526)
|..++++++ +++|||+||.+. ..+++| |.++ +|..++.+... +...+.+..++.+++||++||
T Consensus 219 ~~~~~~v~~-~~~lYvfGG~~~~~~~ndv~~yD~~t~-----~W~~l~~~~~~------P~~R~~h~~~~~~~~iYv~GG 286 (470)
T PLN02193 219 CLGVRMVSI-GSTLYVFGGRDASRQYNGFYSFDTTTN-----EWKLLTPVEEG------PTPRSFHSMAADEENVYVFGG 286 (470)
T ss_pred ccceEEEEE-CCEEEEECCCCCCCCCccEEEEECCCC-----EEEEcCcCCCC------CCCccceEEEEECCEEEEECC
Confidence 445667777 899999999764 357889 8877 78766433110 112234566677999999999
Q ss_pred c-------ceEEEeccCCeEEEeccCC-CCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCc
Q 043369 230 D-------RAILLDYVNNRVMKNYPVM-PGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNE 301 (526)
Q Consensus 230 ~-------~~~~yDp~t~~w~~~~p~~-p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~ 301 (526)
. +.++||+.+++|. .++.. ++..+|.. ++ +++ .+++||++||.+.
T Consensus 287 ~~~~~~~~~~~~yd~~t~~W~-~~~~~~~~~~~R~~--~~-~~~-------------------~~gkiyviGG~~g---- 339 (470)
T PLN02193 287 VSATARLKTLDSYNIVDKKWF-HCSTPGDSFSIRGG--AG-LEV-------------------VQGKVWVVYGFNG---- 339 (470)
T ss_pred CCCCCCcceEEEEECCCCEEE-eCCCCCCCCCCCCC--cE-EEE-------------------ECCcEEEEECCCC----
Confidence 4 3689999999998 45431 12223532 22 222 4899999999752
Q ss_pred hhhhhhcccccccceEEEEeecCCCCceec-c---cCccccccceEEeCCCcEEEEcCcCCCC-CCccCCCCCccccEEE
Q 043369 302 NAAEAQIFLPAAKSCGRLTITAQNPKWEME-E---MPLNRVMGDMILLPTGDVLIINGAAKGT-AGWGAAREPVLNPVIY 376 (526)
Q Consensus 302 ~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~---M~~~R~~~~~vvLpdG~V~vvGG~~~g~-~g~~~~~~~~~~~e~Y 376 (526)
..++.+++||+. +++|+.. + +|.+|..++++++ +++|||+||..... ...........++++|
T Consensus 340 ---------~~~~dv~~yD~~--t~~W~~~~~~g~~P~~R~~~~~~~~-~~~iyv~GG~~~~~~~~~~~~~~~~ndv~~~ 407 (470)
T PLN02193 340 ---------CEVDDVHYYDPV--QDKWTQVETFGVRPSERSVFASAAV-GKHIVIFGGEIAMDPLAHVGPGQLTDGTFAL 407 (470)
T ss_pred ---------CccCceEEEECC--CCEEEEeccCCCCCCCcceeEEEEE-CCEEEEECCccCCccccccCccceeccEEEE
Confidence 125678999986 5899974 4 4889998887766 99999999975210 0000001112368999
Q ss_pred eCCCCcEeecCCC------Cccccccccce--ecCCCEEEEecCCCC
Q 043369 377 CPKINRFRILSPS------LIPRLYHSTAH--LLSDGRVLVGGSNPN 415 (526)
Q Consensus 377 DP~t~~Wt~~a~~------~~~R~yhs~a~--LlpdG~V~v~GG~~~ 415 (526)
||.+++|+.+..+ +.+|..|+.+. +..+.++++.||...
T Consensus 408 D~~t~~W~~~~~~~~~~~~P~~R~~~~~~~~~~~~~~~~~~fGG~~~ 454 (470)
T PLN02193 408 DTETLQWERLDKFGEEEETPSSRGWTASTTGTIDGKKGLVMHGGKAP 454 (470)
T ss_pred EcCcCEEEEcccCCCCCCCCCCCccccceeeEEcCCceEEEEcCCCC
Confidence 9999999988753 57888886533 323345999999753
No 16
>PLN02153 epithiospecifier protein
Probab=99.94 E-value=6.9e-25 Score=226.93 Aligned_cols=280 Identities=15% Similarity=0.122 Sum_probs=186.5
Q ss_pred CCcEEEccc----CCccceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCcc
Q 043369 27 EGKWKLLKR----SIGVSAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTI 102 (526)
Q Consensus 27 ~g~W~~~~~----~~~v~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~ 102 (526)
.++|..+.. .+.-+.-|.++..+++||++||..... .. ......+||+.+++|+.++.
T Consensus 6 ~~~W~~~~~~~~~~P~pR~~h~~~~~~~~iyv~GG~~~~~-------~~-----------~~~~~~~yd~~~~~W~~~~~ 67 (341)
T PLN02153 6 QGGWIKVEQKGGKGPGPRCSHGIAVVGDKLYSFGGELKPN-------EH-----------IDKDLYVFDFNTHTWSIAPA 67 (341)
T ss_pred CCeEEEecCCCCCCCCCCCcceEEEECCEEEEECCccCCC-------Cc-----------eeCcEEEEECCCCEEEEcCc
Confidence 578999864 233355687877899999999974210 00 01357899999999998875
Q ss_pred CC---ccccc-cceEcCCCcEEEEcCCCCC--ccEEEEEcCCCCCCcccccCCCC-----CcccccceeEEecCCcEEEE
Q 043369 103 QT---DTWCS-SGALLANGVLVQTGGYRLG--ERVVRYLKPCSDCDWEEDHQNGL-----ISPRWYASNQILPNGKIIVV 171 (526)
Q Consensus 103 ~~---~~fc~-~~~~l~~G~l~v~GG~~~g--~~~v~~ydp~~t~~W~~~~~~~m-----~~~R~y~s~~~L~dG~v~vi 171 (526)
+. ...|. ..++..+++||++||.... .+.+++|||. +++|+++ .+| +.+|..++++++ +++|||+
T Consensus 68 ~~~~p~~~~~~~~~~~~~~~iyv~GG~~~~~~~~~v~~yd~~-t~~W~~~--~~~~~~~~p~~R~~~~~~~~-~~~iyv~ 143 (341)
T PLN02153 68 NGDVPRISCLGVRMVAVGTKLYIFGGRDEKREFSDFYSYDTV-KNEWTFL--TKLDEEGGPEARTFHSMASD-ENHVYVF 143 (341)
T ss_pred cCCCCCCccCceEEEEECCEEEEECCCCCCCccCcEEEEECC-CCEEEEe--ccCCCCCCCCCceeeEEEEE-CCEEEEE
Confidence 42 22333 3456679999999997532 4689999999 9999988 456 788988888877 8999999
Q ss_pred cCccC----------CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc----------
Q 043369 172 GGRFQ----------FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND---------- 230 (526)
Q Consensus 172 GG~~~----------~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~---------- 230 (526)
||... ..+++| |.++ +|..++.+... +....-+.+++.+|+||++||.
T Consensus 144 GG~~~~~~~~~~~~~~~v~~yd~~~~-----~W~~l~~~~~~------~~~r~~~~~~~~~~~iyv~GG~~~~~~~gG~~ 212 (341)
T PLN02153 144 GGVSKGGLMKTPERFRTIEAYNIADG-----KWVQLPDPGEN------FEKRGGAGFAVVQGKIWVVYGFATSILPGGKS 212 (341)
T ss_pred CCccCCCccCCCcccceEEEEECCCC-----eEeeCCCCCCC------CCCCCcceEEEECCeEEEEeccccccccCCcc
Confidence 99752 257889 8887 78876543210 0011223456679999999862
Q ss_pred -----ceEEEeccCCeEEEeccC---CCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCC---
Q 043369 231 -----RAILLDYVNNRVMKNYPV---MPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDS--- 299 (526)
Q Consensus 231 -----~~~~yDp~t~~w~~~~p~---~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~--- 299 (526)
++++||+.+++|+ .++. +|. +|.. ++ +++ .+++||++||.....
T Consensus 213 ~~~~~~v~~yd~~~~~W~-~~~~~g~~P~--~r~~--~~-~~~-------------------~~~~iyv~GG~~~~~~~~ 267 (341)
T PLN02153 213 DYESNAVQFFDPASGKWT-EVETTGAKPS--ARSV--FA-HAV-------------------VGKYIIIFGGEVWPDLKG 267 (341)
T ss_pred ceecCceEEEEcCCCcEE-eccccCCCCC--Ccce--ee-eEE-------------------ECCEEEEECcccCCcccc
Confidence 4689999999998 4543 233 3542 22 222 489999999963110
Q ss_pred CchhhhhhcccccccceEEEEeecCCCCceec------ccCccccccceE-EeCCCcEEEEcCcCCCCCCccCCCCCccc
Q 043369 300 NENAAEAQIFLPAAKSCGRLTITAQNPKWEME------EMPLNRVMGDMI-LLPTGDVLIINGAAKGTAGWGAAREPVLN 372 (526)
Q Consensus 300 ~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~------~M~~~R~~~~~v-vLpdG~V~vvGG~~~g~~g~~~~~~~~~~ 372 (526)
+... ...++.+++||+. +++|+.. +||.+|..++.+ +.-+++||++||.... .+.+..
T Consensus 268 ~~~~------~~~~n~v~~~d~~--~~~W~~~~~~~~~~~pr~~~~~~~~~v~~~~~~~~~gG~~~~-------~~~~~~ 332 (341)
T PLN02153 268 HLGP------GTLSNEGYALDTE--TLVWEKLGECGEPAMPRGWTAYTTATVYGKNGLLMHGGKLPT-------NERTDD 332 (341)
T ss_pred cccc------ccccccEEEEEcC--ccEEEeccCCCCCCCCCccccccccccCCcceEEEEcCcCCC-------Cccccc
Confidence 0000 1225678999986 5899853 566666533333 3334589999998632 123446
Q ss_pred cEEEeCC
Q 043369 373 PVIYCPK 379 (526)
Q Consensus 373 ~e~YDP~ 379 (526)
+.+|+..
T Consensus 333 ~~~~~~~ 339 (341)
T PLN02153 333 LYFYAVN 339 (341)
T ss_pred eEEEecc
Confidence 6777654
No 17
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=99.93 E-value=2.1e-24 Score=221.60 Aligned_cols=269 Identities=15% Similarity=0.122 Sum_probs=176.1
Q ss_pred ccceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEE-eCCCC-cEEeCccCCccccccceEcC
Q 043369 38 GVSAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEF-DPITR-KVRPLTIQTDTWCSSGALLA 115 (526)
Q Consensus 38 ~v~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~y-Dp~t~-~w~~~~~~~~~fc~~~~~l~ 115 (526)
++.++.++ +.++++|++||.+.. ...+.++.. ..+.....+| |+..+ +|++++.++..++.++++..
T Consensus 3 ~~~g~~~~-~~~~~l~v~GG~~~~--~~~~~~~g~--------~~~~~~v~~~~~~~~~~~W~~~~~lp~~r~~~~~~~~ 71 (323)
T TIGR03548 3 GVAGCYAG-IIGDYILVAGGCNFP--EDPLAEGGK--------KKNYKGIYIAKDENSNLKWVKDGQLPYEAAYGASVSV 71 (323)
T ss_pred ceeeEeee-EECCEEEEeeccCCC--CCchhhCCc--------EEeeeeeEEEecCCCceeEEEcccCCccccceEEEEE
Confidence 44444444 578999999998631 111111110 0122334445 44433 79999888777766667777
Q ss_pred CCcEEEEcCCCCC--ccEEEEEcCCCCCCc----ccccCCCCCcccccceeEEecCCcEEEEcCccC----CeEEEE-cC
Q 043369 116 NGVLVQTGGYRLG--ERVVRYLKPCSDCDW----EEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ----FTYEFI-PR 184 (526)
Q Consensus 116 ~G~l~v~GG~~~g--~~~v~~ydp~~t~~W----~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~----~~~E~y-P~ 184 (526)
+++||++||.... .+.+++||+. +++| ... .+|+.+|..++++++ +++|||+||... ..+++| |.
T Consensus 72 ~~~lyviGG~~~~~~~~~v~~~d~~-~~~w~~~~~~~--~~lp~~~~~~~~~~~-~~~iYv~GG~~~~~~~~~v~~yd~~ 147 (323)
T TIGR03548 72 ENGIYYIGGSNSSERFSSVYRITLD-ESKEELICETI--GNLPFTFENGSACYK-DGTLYVGGGNRNGKPSNKSYLFNLE 147 (323)
T ss_pred CCEEEEEcCCCCCCCceeEEEEEEc-CCceeeeeeEc--CCCCcCccCceEEEE-CCEEEEEeCcCCCccCceEEEEcCC
Confidence 9999999997532 4689999998 8887 666 589999988888887 899999999732 468999 88
Q ss_pred CCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc------ceEEEeccCCeEEEeccCCCCC-CCCcc
Q 043369 185 TSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND------RAILLDYVNNRVMKNYPVMPGG-ISRNY 257 (526)
Q Consensus 185 ~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~------~~~~yDp~t~~w~~~~p~~p~~-~~r~y 257 (526)
++ +|..++.+.... ...++.+..+++||++||. +.++||+++++|. .+++++.. .+|..
T Consensus 148 ~~-----~W~~~~~~p~~~--------r~~~~~~~~~~~iYv~GG~~~~~~~~~~~yd~~~~~W~-~~~~~~~~~~p~~~ 213 (323)
T TIGR03548 148 TQ-----EWFELPDFPGEP--------RVQPVCVKLQNELYVFGGGSNIAYTDGYKYSPKKNQWQ-KVADPTTDSEPISL 213 (323)
T ss_pred CC-----CeeECCCCCCCC--------CCcceEEEECCEEEEEcCCCCccccceEEEecCCCeeE-ECCCCCCCCCceec
Confidence 87 787765332110 1123456679999999995 3589999999998 57655321 12321
Q ss_pred CCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhh-h-------------h-hcc-----cccccceE
Q 043369 258 PSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAA-E-------------A-QIF-----LPAAKSCG 317 (526)
Q Consensus 258 ~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~-~-------------~-~~~-----~~a~~s~~ 317 (526)
. ..+++. ..+++||++||.+...+.+.. . . .+. ..-.++++
T Consensus 214 ~-~~~~~~------------------~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~ 274 (323)
T TIGR03548 214 L-GAASIK------------------INESLLLCIGGFNKDVYNDAVIDLATMKDESLKGYKKEYFLKPPEWYNWNRKIL 274 (323)
T ss_pred c-ceeEEE------------------ECCCEEEEECCcCHHHHHHHHhhhhhccchhhhhhHHHHhCCCccccCcCceEE
Confidence 1 112221 147899999997621100000 0 0 000 00136799
Q ss_pred EEEeecCCCCceec-ccC-ccccccceEEeCCCcEEEEcCcC
Q 043369 318 RLTITAQNPKWEME-EMP-LNRVMGDMILLPTGDVLIINGAA 357 (526)
Q Consensus 318 ~~d~~~~~~~W~~~-~M~-~~R~~~~~vvLpdG~V~vvGG~~ 357 (526)
+||+. +++|+.. +|+ .+|..++++++ +++||++||..
T Consensus 275 ~yd~~--~~~W~~~~~~p~~~r~~~~~~~~-~~~iyv~GG~~ 313 (323)
T TIGR03548 275 IYNVR--TGKWKSIGNSPFFARCGAALLLT-GNNIFSINGEL 313 (323)
T ss_pred EEECC--CCeeeEcccccccccCchheEEE-CCEEEEEeccc
Confidence 99997 5899986 787 58888877665 99999999975
No 18
>PHA03098 kelch-like protein; Provisional
Probab=99.93 E-value=1.3e-24 Score=238.15 Aligned_cols=248 Identities=13% Similarity=0.093 Sum_probs=179.3
Q ss_pred cEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccC-----CeEEEE-cCCCCCCCc
Q 043369 118 VLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQ-----FTYEFI-PRTSDSDRK 191 (526)
Q Consensus 118 ~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~-----~~~E~y-P~~~~~~~~ 191 (526)
.+++.||..+....+..|++. ..+|..+ .+++..+ .++++++ +++||++||... ..+..| |.++
T Consensus 252 ~~~~~~g~~~~~~~~~~~~~~-~~~~~~~--~~~~~~~-~~~~~~~-~~~lyv~GG~~~~~~~~~~v~~yd~~~~----- 321 (534)
T PHA03098 252 IIYIHITMSIFTYNYITNYSP-LSEINTI--IDIHYVY-CFGSVVL-NNVIYFIGGMNKNNLSVNSVVSYDTKTK----- 321 (534)
T ss_pred ceEeecccchhhceeeecchh-hhhcccc--cCccccc-cceEEEE-CCEEEEECCCcCCCCeeccEEEEeCCCC-----
Confidence 345555543223456678888 7889887 3454333 3466666 899999999864 246778 8877
Q ss_pred ceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------ceEEEeccCCeEEEeccCCCCCCCCccCCCCcee
Q 043369 192 ILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSV 264 (526)
Q Consensus 192 ~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v 264 (526)
+|..+|.+...+ +.+..+..+|+||++||. ++++||+.+++|. .++++|. +|.. +++++
T Consensus 322 ~W~~~~~~~~~R---------~~~~~~~~~~~lyv~GG~~~~~~~~~v~~yd~~~~~W~-~~~~lp~--~r~~--~~~~~ 387 (534)
T PHA03098 322 SWNKVPELIYPR---------KNPGVTVFNNRIYVIGGIYNSISLNTVESWKPGESKWR-EEPPLIF--PRYN--PCVVN 387 (534)
T ss_pred eeeECCCCCccc---------ccceEEEECCEEEEEeCCCCCEecceEEEEcCCCCcee-eCCCcCc--CCcc--ceEEE
Confidence 787776543211 224556779999999995 3789999999998 5777776 4643 22222
Q ss_pred ecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccccccceE
Q 043369 265 LLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMI 343 (526)
Q Consensus 265 ~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~v 343 (526)
.+++||++||...+ ...++++++||+. +++|+.. +||.+|..++++
T Consensus 388 --------------------~~~~iYv~GG~~~~-----------~~~~~~v~~yd~~--t~~W~~~~~~p~~r~~~~~~ 434 (534)
T PHA03098 388 --------------------VNNLIYVIGGISKN-----------DELLKTVECFSLN--TNKWSKGSPLPISHYGGCAI 434 (534)
T ss_pred --------------------ECCEEEEECCcCCC-----------CcccceEEEEeCC--CCeeeecCCCCccccCceEE
Confidence 48999999996422 1236789999986 5899986 999999988877
Q ss_pred EeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCCCCCcCCC
Q 043369 344 LLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNVNYNFSAL 423 (526)
Q Consensus 344 vLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~~~~~~~~ 423 (526)
++ +++|||+||..... .......+++|||.+++|+.+++++.+|..|+.+++ ||+|||.||.....+
T Consensus 435 ~~-~~~iyv~GG~~~~~-----~~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~--~~~iyv~GG~~~~~~----- 501 (534)
T PHA03098 435 YH-DGKIYVIGGISYID-----NIKVYNIVESYNPVTNKWTELSSLNFPRINASLCIF--NNKIYVVGGDKYEYY----- 501 (534)
T ss_pred EE-CCEEEEECCccCCC-----CCcccceEEEecCCCCceeeCCCCCcccccceEEEE--CCEEEEEcCCcCCcc-----
Confidence 65 99999999975211 011233589999999999999999999999987666 999999999754321
Q ss_pred CCCceeeEEEcCccc
Q 043369 424 FPTELSLQAFYPPYF 438 (526)
Q Consensus 424 ~p~~~~vE~y~Ppyl 438 (526)
...+|+|+|.--
T Consensus 502 ---~~~v~~yd~~~~ 513 (534)
T PHA03098 502 ---INEIEVYDDKTN 513 (534)
T ss_pred ---cceeEEEeCCCC
Confidence 247999998863
No 19
>PLN02193 nitrile-specifier protein
Probab=99.92 E-value=1.7e-23 Score=225.20 Aligned_cols=263 Identities=16% Similarity=0.141 Sum_probs=182.8
Q ss_pred cCCCcEEEEcCCCC-CccEEEE--EcCCC---CCCcccccC-CCCCcccccceeEEecCCcEEEEcCccC------CeEE
Q 043369 114 LANGVLVQTGGYRL-GERVVRY--LKPCS---DCDWEEDHQ-NGLISPRWYASNQILPNGKIIVVGGRFQ------FTYE 180 (526)
Q Consensus 114 l~~G~l~v~GG~~~-g~~~v~~--ydp~~---t~~W~~~~~-~~m~~~R~y~s~~~L~dG~v~viGG~~~------~~~E 180 (526)
+.+++|+.++|... ...++-. ++|.+ .++|..+.+ .+++.+|..|+++++ +++|||+||... ..++
T Consensus 118 ~~~~~ivgf~G~~~~~~~~ig~y~~~~~~~~~~~~W~~~~~~~~~P~pR~~h~~~~~-~~~iyv~GG~~~~~~~~~~~v~ 196 (470)
T PLN02193 118 LQGGKIVGFHGRSTDVLHSLGAYISLPSTPKLLGKWIKVEQKGEGPGLRCSHGIAQV-GNKIYSFGGEFTPNQPIDKHLY 196 (470)
T ss_pred EcCCeEEEEeccCCCcEEeeEEEEecCCChhhhceEEEcccCCCCCCCccccEEEEE-CCEEEEECCcCCCCCCeeCcEE
Confidence 45889999999753 2344444 48751 279998721 136889999999988 789999999742 2477
Q ss_pred EE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-------ceEEEeccCCeEEEeccCCCC-
Q 043369 181 FI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-------RAILLDYVNNRVMKNYPVMPG- 251 (526)
Q Consensus 181 ~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-------~~~~yDp~t~~w~~~~p~~p~- 251 (526)
+| +.++ +|..++..... . .....-+..+..+++||++||. +.++||+.+++|. .+++++.
T Consensus 197 ~yD~~~~-----~W~~~~~~g~~-P----~~~~~~~~~v~~~~~lYvfGG~~~~~~~ndv~~yD~~t~~W~-~l~~~~~~ 265 (470)
T PLN02193 197 VFDLETR-----TWSISPATGDV-P----HLSCLGVRMVSIGSTLYVFGGRDASRQYNGFYSFDTTTNEWK-LLTPVEEG 265 (470)
T ss_pred EEECCCC-----EEEeCCCCCCC-C----CCcccceEEEEECCEEEEECCCCCCCCCccEEEEECCCCEEE-EcCcCCCC
Confidence 88 8776 78755432110 0 0011234556679999999994 4789999999998 4655421
Q ss_pred CCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec
Q 043369 252 GISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME 331 (526)
Q Consensus 252 ~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~ 331 (526)
+.+|.+ .+++. .+++||++||.+.. ..++.+++||+. +++|+..
T Consensus 266 P~~R~~---h~~~~-------------------~~~~iYv~GG~~~~------------~~~~~~~~yd~~--t~~W~~~ 309 (470)
T PLN02193 266 PTPRSF---HSMAA-------------------DEENVYVFGGVSAT------------ARLKTLDSYNIV--DKKWFHC 309 (470)
T ss_pred CCCccc---eEEEE-------------------ECCEEEEECCCCCC------------CCcceEEEEECC--CCEEEeC
Confidence 224653 22222 48999999998621 235678999986 5899874
Q ss_pred ----ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCC---CccccccccceecCC
Q 043369 332 ----EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPS---LIPRLYHSTAHLLSD 404 (526)
Q Consensus 332 ----~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~---~~~R~yhs~a~Llpd 404 (526)
.|+.+|..+.++++ +|+||++||.. +. ....+++|||++++|+.++++ +.+|..|+++++ +
T Consensus 310 ~~~~~~~~~R~~~~~~~~-~gkiyviGG~~-g~--------~~~dv~~yD~~t~~W~~~~~~g~~P~~R~~~~~~~~--~ 377 (470)
T PLN02193 310 STPGDSFSIRGGAGLEVV-QGKVWVVYGFN-GC--------EVDDVHYYDPVQDKWTQVETFGVRPSERSVFASAAV--G 377 (470)
T ss_pred CCCCCCCCCCCCcEEEEE-CCcEEEEECCC-CC--------ccCceEEEECCCCEEEEeccCCCCCCCcceeEEEEE--C
Confidence 37788988887665 99999999975 21 134689999999999998765 889999998776 9
Q ss_pred CEEEEecCCCCCCCC-c--CCCCCCceeeEEEcCccc
Q 043369 405 GRVLVGGSNPNVNYN-F--SALFPTELSLQAFYPPYF 438 (526)
Q Consensus 405 G~V~v~GG~~~~~~~-~--~~~~p~~~~vE~y~Ppyl 438 (526)
++|||+||....... . .+.+ ..++++|+|.-.
T Consensus 378 ~~iyv~GG~~~~~~~~~~~~~~~--~ndv~~~D~~t~ 412 (470)
T PLN02193 378 KHIVIFGGEIAMDPLAHVGPGQL--TDGTFALDTETL 412 (470)
T ss_pred CEEEEECCccCCccccccCccce--eccEEEEEcCcC
Confidence 999999997432110 0 0111 236899999865
No 20
>cd02851 Galactose_oxidase_C_term Galactose oxidase C-terminus domain. Galactose oxidase is an extracellular monomeric enzyme which catalyses the stereospecific oxidation of a broad range of primary alcohol substrates and possesses a unique mononuclear copper site essential for catalysing a two-electron transfer reaction during the oxidation of primary alcohols to corresponding aldehydes. The second redox active center necessary for the reaction was found to be situated at a tyrosine residue. The C-terminus of galactose oxidase may be related to the immunoglobulin and/or fibronectin type III superfamilies. These domains are associated with different types of catalytic domains at either the N-terminal or C-terminal end and may be involved in homodimeric/tetrameric/dodecameric interactions. Members of this family include members of the alpha amylase family, sialidase, galactose oxidase, cellulase, cellulose, hyaluronate lyase, chitobiase, and chitinase.
Probab=99.91 E-value=7.4e-25 Score=183.39 Aligned_cols=78 Identities=26% Similarity=0.294 Sum_probs=70.6
Q ss_pred CCCCCCCeeeecCCCCccceecCCeEEEEEEeccCCcceEEEEEeecCcccccCCCCcceeecCce--------------
Q 043369 441 MSNRSRPSISTVKPGAFLKLKYTENFLLGFKLRSGDLGEIFVTMVAPSFTTHSFAMNQRLLVLELH-------------- 506 (526)
Q Consensus 441 ~~~~~RP~i~~~~p~~~~~~~~g~~~~v~~~~~~~~~~~~~v~l~~~~~~THs~n~~QR~v~L~~~-------------- 506 (526)
|++|.||+|.++ |. .+++||++|+|+++. .+.+|+|+|++|+|||+|||||+|+|+++
T Consensus 1 g~~a~RP~I~~~-p~--~~i~yG~~f~v~~~~-----~i~~v~Lvr~~~~THs~~~~QR~v~L~~~~~~~~~~~v~~P~n 72 (101)
T cd02851 1 GTLASRPVITSA-ST--QTAKVGDTITVSTDS-----PISSASLVRYGSATHTVNTDQRRIPLTLFSVGGNSYSVQIPSD 72 (101)
T ss_pred CCCCCCCeeccC-Cc--cccccCCEEEEEEec-----cceEEEEEecccccccccCCccEEEeeeEecCCCEEEEEcCCC
Confidence 456899999999 73 579999999999873 47999999999999999999999999977
Q ss_pred --------EEEEEEc-CCcccccEEEEcC
Q 043369 507 --------GALFLVN-DGVPSKAVWVQMK 526 (526)
Q Consensus 507 --------ymlf~~~-~gvPS~~~~v~i~ 526 (526)
|||||++ +||||+|+||+|+
T Consensus 73 ~~vaPPGyYmLFvv~~~GvPS~a~wV~i~ 101 (101)
T cd02851 73 PGVALPGYYMLFVMNSAGVPSVAKTIRIT 101 (101)
T ss_pred CCcCCCcCeEEEEECCCCcccccEEEEeC
Confidence 9999995 9999999999985
No 21
>PF09118 DUF1929: Domain of unknown function (DUF1929); InterPro: IPR015202 This domain adopts a secondary structure consisting of a bundle of seven, mostly antiparallel, beta-strands surrounding a hydrophobic core. The 7 strands are arranged in 2 sheets, in a Greek-key topology. Their precise function, has not, as yet, been defined, though they are mostly found in sugar-utilising enzymes, such as galactose oxidase []. ; PDB: 2JKX_A 2EIC_A 1K3I_A 1GOH_A 2EIB_A 2WQ8_A 2VZ1_A 1GOF_A 2VZ3_A 1GOG_A ....
Probab=99.91 E-value=1.3e-24 Score=182.25 Aligned_cols=75 Identities=45% Similarity=0.762 Sum_probs=53.3
Q ss_pred CCeeeecCCCCccceecCCeEEEEEEeccCCcceEEEEEeecCcccccCCCCcceeecCce-------------------
Q 043369 446 RPSISTVKPGAFLKLKYTENFLLGFKLRSGDLGEIFVTMVAPSFTTHSFAMNQRLLVLELH------------------- 506 (526)
Q Consensus 446 RP~i~~~~p~~~~~~~~g~~~~v~~~~~~~~~~~~~v~l~~~~~~THs~n~~QR~v~L~~~------------------- 506 (526)
||+|+++ | .++.||++|+|+++.+. ..++.+|+|+|+||+|||+|||||+|+|++.
T Consensus 1 RP~i~~~-p---~~i~yg~~~tv~~~~~~-~~~~~~v~L~~~~~~THs~~~~QR~v~L~~~~~~~~~~~v~~P~~~~vaP 75 (98)
T PF09118_consen 1 RPVITSA-P---TTIKYGQTFTVTVTVPS-AASIVKVSLVRPGFVTHSFNMGQRMVELEFVSGGGNTVTVTAPPNPNVAP 75 (98)
T ss_dssp ---EEES-----SEEETT-EEEEEE--SS----ESEEEEEE--EEETTB-SS-EEEEE-EEEESSSEEEEE--S-TTTS-
T ss_pred CCccccC-C---CeEecCCEEEEEEECCC-ccceEEEEEEeCCcccccccCCCCEEeeeeecCCCCEEEEECCCCCccCC
Confidence 9999998 9 99999999999998754 4578999999999999999999999999995
Q ss_pred ---EEEEEEc-CCcccccEEEEc
Q 043369 507 ---GALFLVN-DGVPSKAVWVQM 525 (526)
Q Consensus 507 ---ymlf~~~-~gvPS~~~~v~i 525 (526)
|||||++ +||||+|+||+|
T Consensus 76 PG~YmLFvv~~~GvPS~a~wV~v 98 (98)
T PF09118_consen 76 PGYYMLFVVNDDGVPSVAKWVQV 98 (98)
T ss_dssp SEEEEEEEEETTS-B---EEEEE
T ss_pred CcCEEEEEEcCCCcccccEEEEC
Confidence 9999999 999999999997
No 22
>KOG4693 consensus Uncharacterized conserved protein, contains kelch repeat [General function prediction only]
Probab=99.73 E-value=3e-16 Score=149.29 Aligned_cols=257 Identities=17% Similarity=0.190 Sum_probs=166.2
Q ss_pred cccceEcCCCcEEEEcCCCCCc-------cEEEEEcCCCCCCcccccC-----------CCCCcccccceeEEecCCcEE
Q 043369 108 CSSGALLANGVLVQTGGYRLGE-------RVVRYLKPCSDCDWEEDHQ-----------NGLISPRWYASNQILPNGKII 169 (526)
Q Consensus 108 c~~~~~l~~G~l~v~GG~~~g~-------~~v~~ydp~~t~~W~~~~~-----------~~m~~~R~y~s~~~L~dG~v~ 169 (526)
-..+++....+||.+||+-.|. -.|.+++.. +-.|+.+++ .-.+..|..|+++.. ++++|
T Consensus 15 VNHAavaVG~riYSFGGYCsGedy~~~~piDVH~lNa~-~~RWtk~pp~~~ka~i~~~yp~VPyqRYGHtvV~y-~d~~y 92 (392)
T KOG4693|consen 15 VNHAAVAVGSRIYSFGGYCSGEDYDAKDPIDVHVLNAE-NYRWTKMPPGITKATIESPYPAVPYQRYGHTVVEY-QDKAY 92 (392)
T ss_pred ccceeeeecceEEecCCcccccccccCCcceeEEeecc-ceeEEecCcccccccccCCCCccchhhcCceEEEE-cceEE
Confidence 3345556678999999985331 257788887 888998743 013456888888877 88999
Q ss_pred EEcCccCC-----eEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc---------ceEE
Q 043369 170 VVGGRFQF-----TYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND---------RAIL 234 (526)
Q Consensus 170 viGG~~~~-----~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~---------~~~~ 234 (526)
|-||++.. ..-.| |+++.|. +....-.++..+| -|.+++.+..+|+|||. +...
T Consensus 93 vWGGRND~egaCN~Ly~fDp~t~~W~--~p~v~G~vPgaRD---------GHsAcV~gn~MyiFGGye~~a~~FS~d~h~ 161 (392)
T KOG4693|consen 93 VWGGRNDDEGACNLLYEFDPETNVWK--KPEVEGFVPGARD---------GHSACVWGNQMYIFGGYEEDAQRFSQDTHV 161 (392)
T ss_pred EEcCccCcccccceeeeecccccccc--ccceeeecCCccC---------CceeeEECcEEEEecChHHHHHhhhcccee
Confidence 99999752 23345 9988441 1111122323333 25667779999999994 3567
Q ss_pred EeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCch--hhhhhccccc
Q 043369 235 LDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNEN--AAEAQIFLPA 312 (526)
Q Consensus 235 yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~--~~~~~~~~~a 312 (526)
+|..|-+|. .+-..-.+ +|+-- ..++++ +++..||+||... .+.- +...++
T Consensus 162 ld~~TmtWr-~~~Tkg~P-prwRD-FH~a~~-------------------~~~~MYiFGGR~D-~~gpfHs~~e~Y---- 214 (392)
T KOG4693|consen 162 LDFATMTWR-EMHTKGDP-PRWRD-FHTASV-------------------IDGMMYIFGGRSD-ESGPFHSIHEQY---- 214 (392)
T ss_pred Eeccceeee-ehhccCCC-chhhh-hhhhhh-------------------ccceEEEeccccc-cCCCccchhhhh----
Confidence 899999997 33221111 34322 233443 4899999999752 1110 000111
Q ss_pred ccceEEEEeecCCCCcee--c--ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecC-
Q 043369 313 AKSCGRLTITAQNPKWEM--E--EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILS- 387 (526)
Q Consensus 313 ~~s~~~~d~~~~~~~W~~--~--~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a- 387 (526)
.+..-.+|.. +..|.. + -.|.+|..|++-+. ||++|++||.+ |.- +.-.....+|||.+..|+.+.
T Consensus 215 c~~i~~ld~~--T~aW~r~p~~~~~P~GRRSHS~fvY-ng~~Y~FGGYn-g~l-----n~HfndLy~FdP~t~~W~~I~~ 285 (392)
T KOG4693|consen 215 CDTIMALDLA--TGAWTRTPENTMKPGGRRSHSTFVY-NGKMYMFGGYN-GTL-----NVHFNDLYCFDPKTSMWSVISV 285 (392)
T ss_pred cceeEEEecc--ccccccCCCCCcCCCcccccceEEE-cceEEEecccc-hhh-----hhhhcceeecccccchheeeec
Confidence 2333445654 588985 2 35788988887776 99999999987 431 111224689999999998764
Q ss_pred --CCCccccccccceecCCCEEEEecCCCC
Q 043369 388 --PSLIPRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 388 --~~~~~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
.-+.+|.-|++.+. +|||+.+||-..
T Consensus 286 ~Gk~P~aRRRqC~~v~--g~kv~LFGGTsP 313 (392)
T KOG4693|consen 286 RGKYPSARRRQCSVVS--GGKVYLFGGTSP 313 (392)
T ss_pred cCCCCCcccceeEEEE--CCEEEEecCCCC
Confidence 35677777876655 999999999644
No 23
>KOG4693 consensus Uncharacterized conserved protein, contains kelch repeat [General function prediction only]
Probab=99.70 E-value=2.2e-15 Score=143.42 Aligned_cols=262 Identities=15% Similarity=0.165 Sum_probs=175.6
Q ss_pred cEEE-cccCCccceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccC----
Q 043369 29 KWKL-LKRSIGVSAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQ---- 103 (526)
Q Consensus 29 ~W~~-~~~~~~v~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~---- 103 (526)
.|.. |.+ -+.+.-|+|+-...+||-+||+-.|..-- .+ -.-.+.+++.++-+|+.++..
T Consensus 3 ~WTVHLeG-GPrRVNHAavaVG~riYSFGGYCsGedy~------------~~---~piDVH~lNa~~~RWtk~pp~~~ka 66 (392)
T KOG4693|consen 3 TWTVHLEG-GPRRVNHAAVAVGSRIYSFGGYCSGEDYD------------AK---DPIDVHVLNAENYRWTKMPPGITKA 66 (392)
T ss_pred eEEEEecC-CcccccceeeeecceEEecCCcccccccc------------cC---CcceeEEeeccceeEEecCcccccc
Confidence 4765 333 23456799998899999999985432100 00 122477899999999988751
Q ss_pred ---------CccccccceEcCCCcEEEEcCCCC--C-ccEEEEEcCCCCCCccccc-CCCCCcccccceeEEecCCcEEE
Q 043369 104 ---------TDTWCSSGALLANGVLVQTGGYRL--G-ERVVRYLKPCSDCDWEEDH-QNGLISPRWYASNQILPNGKIIV 170 (526)
Q Consensus 104 ---------~~~fc~~~~~l~~G~l~v~GG~~~--g-~~~v~~ydp~~t~~W~~~~-~~~m~~~R~y~s~~~L~dG~v~v 170 (526)
+-.+....++..++++|+-||.+| + -+....|||. +++|.... ..-++-.|-.|+++++ ++..||
T Consensus 67 ~i~~~yp~VPyqRYGHtvV~y~d~~yvWGGRND~egaCN~Ly~fDp~-t~~W~~p~v~G~vPgaRDGHsAcV~-gn~Myi 144 (392)
T KOG4693|consen 67 TIESPYPAVPYQRYGHTVVEYQDKAYVWGGRNDDEGACNLLYEFDPE-TNVWKKPEVEGFVPGARDGHSACVW-GNQMYI 144 (392)
T ss_pred cccCCCCccchhhcCceEEEEcceEEEEcCccCcccccceeeeeccc-cccccccceeeecCCccCCceeeEE-CcEEEE
Confidence 224555566777999999999865 3 3677899999 99998641 1247778999999999 789999
Q ss_pred EcCccC----CeEEE--E-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc------------
Q 043369 171 VGGRFQ----FTYEF--I-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR------------ 231 (526)
Q Consensus 171 iGG~~~----~~~E~--y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~------------ 231 (526)
.||... .+-++ + -.+- +|..+-.- .+ .+++.--|...+.++.+|+|||+.
T Consensus 145 FGGye~~a~~FS~d~h~ld~~Tm-----tWr~~~Tk---g~---PprwRDFH~a~~~~~~MYiFGGR~D~~gpfHs~~e~ 213 (392)
T KOG4693|consen 145 FGGYEEDAQRFSQDTHVLDFATM-----TWREMHTK---GD---PPRWRDFHTASVIDGMMYIFGGRSDESGPFHSIHEQ 213 (392)
T ss_pred ecChHHHHHhhhccceeEeccce-----eeeehhcc---CC---CchhhhhhhhhhccceEEEeccccccCCCccchhhh
Confidence 999753 12222 2 2232 67644210 00 112222245677799999999963
Q ss_pred ----eEEEeccCCeEEEeccCC---CCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhh
Q 043369 232 ----AILLDYVNNRVMKNYPVM---PGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAA 304 (526)
Q Consensus 232 ----~~~yDp~t~~w~~~~p~~---p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~ 304 (526)
...+|.+|+.|.+ .|+. |.+ +|+ .++-. +++++|++||.+.. -
T Consensus 214 Yc~~i~~ld~~T~aW~r-~p~~~~~P~G-RRS----HS~fv-------------------Yng~~Y~FGGYng~-l---- 263 (392)
T KOG4693|consen 214 YCDTIMALDLATGAWTR-TPENTMKPGG-RRS----HSTFV-------------------YNGKMYMFGGYNGT-L---- 263 (392)
T ss_pred hcceeEEEecccccccc-CCCCCcCCCc-ccc----cceEE-------------------EcceEEEecccchh-h----
Confidence 3468999999985 4443 333 332 33221 69999999998621 0
Q ss_pred hhhcccccccceEEEEeecCCCCceec----ccCccccccceEEeCCCcEEEEcCcC
Q 043369 305 EAQIFLPAAKSCGRLTITAQNPKWEME----EMPLNRVMGDMILLPTGDVLIINGAA 357 (526)
Q Consensus 305 ~~~~~~~a~~s~~~~d~~~~~~~W~~~----~M~~~R~~~~~vvLpdG~V~vvGG~~ 357 (526)
..-.+...++||. +..|... .-|.+|.-.++++. ++|||++||..
T Consensus 264 -----n~HfndLy~FdP~--t~~W~~I~~~Gk~P~aRRRqC~~v~-g~kv~LFGGTs 312 (392)
T KOG4693|consen 264 -----NVHFNDLYCFDPK--TSMWSVISVRGKYPSARRRQCSVVS-GGKVYLFGGTS 312 (392)
T ss_pred -----hhhhcceeecccc--cchheeeeccCCCCCcccceeEEEE-CCEEEEecCCC
Confidence 1224667889986 5889862 56778887887776 99999999975
No 24
>KOG0379 consensus Kelch repeat-containing proteins [General function prediction only]
Probab=99.44 E-value=1.2e-11 Score=133.52 Aligned_cols=245 Identities=17% Similarity=0.171 Sum_probs=167.8
Q ss_pred ccccceEcCCCcEEEEcCCCCC--cc--EEEEEcCCCCCCcccccC-CCCCcccccceeEEecCCcEEEEcCccC-----
Q 043369 107 WCSSGALLANGVLVQTGGYRLG--ER--VVRYLKPCSDCDWEEDHQ-NGLISPRWYASNQILPNGKIIVVGGRFQ----- 176 (526)
Q Consensus 107 fc~~~~~l~~G~l~v~GG~~~g--~~--~v~~ydp~~t~~W~~~~~-~~m~~~R~y~s~~~L~dG~v~viGG~~~----- 176 (526)
+-...+.+.+.+++|+||...+ .. .+.+||-. +..|..... ..-+.+|..++.+++ +.++|++||.+.
T Consensus 61 R~~hs~~~~~~~~~vfGG~~~~~~~~~~dl~~~d~~-~~~w~~~~~~g~~p~~r~g~~~~~~-~~~l~lfGG~~~~~~~~ 138 (482)
T KOG0379|consen 61 RAGHSAVLIGNKLYVFGGYGSGDRLTDLDLYVLDLE-SQLWTKPAATGDEPSPRYGHSLSAV-GDKLYLFGGTDKKYRNL 138 (482)
T ss_pred hhccceeEECCEEEEECCCCCCCccccceeEEeecC-CcccccccccCCCCCcccceeEEEE-CCeEEEEccccCCCCCh
Confidence 3444555669999999997632 22 58999988 889987521 245678988888888 789999999874
Q ss_pred CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc--------ceEEEeccCCeEEEecc
Q 043369 177 FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND--------RAILLDYVNNRVMKNYP 247 (526)
Q Consensus 177 ~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~--------~~~~yDp~t~~w~~~~p 247 (526)
..+..| +.+. +|..+..... .+-....|.+++.+.+||++||. +.++||.++.+|.+ +.
T Consensus 139 ~~l~~~d~~t~-----~W~~l~~~~~------~P~~r~~Hs~~~~g~~l~vfGG~~~~~~~~ndl~i~d~~~~~W~~-~~ 206 (482)
T KOG0379|consen 139 NELHSLDLSTR-----TWSLLSPTGD------PPPPRAGHSATVVGTKLVVFGGIGGTGDSLNDLHIYDLETSTWSE-LD 206 (482)
T ss_pred hheEeccCCCC-----cEEEecCcCC------CCCCcccceEEEECCEEEEECCccCcccceeeeeeecccccccee-cc
Confidence 134455 6665 6765432211 12233456778889999999993 57999999999984 42
Q ss_pred CC-CCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCC
Q 043369 248 VM-PGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNP 326 (526)
Q Consensus 248 ~~-p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~ 326 (526)
.. +.+.+|.. ++.++ .+.+++++||...+. -.++.+.++|+. +.
T Consensus 207 ~~g~~P~pR~g--H~~~~--------------------~~~~~~v~gG~~~~~-----------~~l~D~~~ldl~--~~ 251 (482)
T KOG0379|consen 207 TQGEAPSPRYG--HAMVV--------------------VGNKLLVFGGGDDGD-----------VYLNDVHILDLS--TW 251 (482)
T ss_pred cCCCCCCCCCC--ceEEE--------------------ECCeEEEEeccccCC-----------ceecceEeeecc--cc
Confidence 21 22224542 22222 488999999976221 237788999986 48
Q ss_pred Cceec----ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCC----Ccccccccc
Q 043369 327 KWEME----EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPS----LIPRLYHST 398 (526)
Q Consensus 327 ~W~~~----~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~----~~~R~yhs~ 398 (526)
+|... .+|.+|..|..++ .+.+++++||...+. ..+..+...||.++..|+.+... +.+|..|..
T Consensus 252 ~W~~~~~~g~~p~~R~~h~~~~-~~~~~~l~gG~~~~~------~~~l~~~~~l~~~~~~w~~~~~~~~~~~~~~~~~~~ 324 (482)
T KOG0379|consen 252 EWKLLPTGGDLPSPRSGHSLTV-SGDHLLLFGGGTDPK------QEPLGDLYGLDLETLVWSKVESVGVVRPSPRLGHAA 324 (482)
T ss_pred eeeeccccCCCCCCcceeeeEE-ECCEEEEEcCCcccc------cccccccccccccccceeeeeccccccccccccccc
Confidence 88842 7899999999885 488999999976320 11445678899999999876543 578888887
Q ss_pred ceecCCCEE
Q 043369 399 AHLLSDGRV 407 (526)
Q Consensus 399 a~LlpdG~V 407 (526)
.+.-..+..
T Consensus 325 ~~~~~~~~~ 333 (482)
T KOG0379|consen 325 ELIDELGKD 333 (482)
T ss_pred eeeccCCcc
Confidence 666444443
No 25
>KOG0379 consensus Kelch repeat-containing proteins [General function prediction only]
Probab=99.43 E-value=6.6e-12 Score=135.54 Aligned_cols=211 Identities=16% Similarity=0.163 Sum_probs=146.3
Q ss_pred CCCcccccceeEEecCCcEEEEcCccCC----eEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcE
Q 043369 150 GLISPRWYASNQILPNGKIIVVGGRFQF----TYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNL 224 (526)
Q Consensus 150 ~m~~~R~y~s~~~L~dG~v~viGG~~~~----~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~I 224 (526)
..+.+|+.|+++.. +.++||.||.... ..++| ..... ..|..... ... .+...|-+.....+.+|
T Consensus 56 ~~p~~R~~hs~~~~-~~~~~vfGG~~~~~~~~~~dl~~~d~~~---~~w~~~~~-~g~-----~p~~r~g~~~~~~~~~l 125 (482)
T KOG0379|consen 56 VGPIPRAGHSAVLI-GNKLYVFGGYGSGDRLTDLDLYVLDLES---QLWTKPAA-TGD-----EPSPRYGHSLSAVGDKL 125 (482)
T ss_pred CCcchhhccceeEE-CCEEEEECCCCCCCccccceeEEeecCC---cccccccc-cCC-----CCCcccceeEEEECCeE
Confidence 46778999988888 8999999997642 11355 33321 24543211 111 12334556667779999
Q ss_pred EEEEccc--------eEEEeccCCeEEEeccCCCC-CCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCC
Q 043369 225 FIFANDR--------AILLDYVNNRVMKNYPVMPG-GISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGT 295 (526)
Q Consensus 225 y~~Gg~~--------~~~yDp~t~~w~~~~p~~p~-~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~ 295 (526)
|++||+. ...||..+++|.. +..... +.+|.. .+++. .+.+|||+||.
T Consensus 126 ~lfGG~~~~~~~~~~l~~~d~~t~~W~~-l~~~~~~P~~r~~---Hs~~~-------------------~g~~l~vfGG~ 182 (482)
T KOG0379|consen 126 YLFGGTDKKYRNLNELHSLDLSTRTWSL-LSPTGDPPPPRAG---HSATV-------------------VGTKLVVFGGI 182 (482)
T ss_pred EEEccccCCCCChhheEeccCCCCcEEE-ecCcCCCCCCccc---ceEEE-------------------ECCEEEEECCc
Confidence 9999954 6789999999984 332222 224542 23332 47999999998
Q ss_pred CCCCCchhhhhhcccccccceEEEEeecCCCCceec----ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCcc
Q 043369 296 LPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME----EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVL 371 (526)
Q Consensus 296 ~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~----~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~ 371 (526)
+.. ...++.+++||+. +.+|... +-|.||..|.+++. ++++|++||...+. ....
T Consensus 183 ~~~-----------~~~~ndl~i~d~~--~~~W~~~~~~g~~P~pR~gH~~~~~-~~~~~v~gG~~~~~-------~~l~ 241 (482)
T KOG0379|consen 183 GGT-----------GDSLNDLHIYDLE--TSTWSELDTQGEAPSPRYGHAMVVV-GNKLLVFGGGDDGD-------VYLN 241 (482)
T ss_pred cCc-----------ccceeeeeeeccc--cccceecccCCCCCCCCCCceEEEE-CCeEEEEeccccCC-------ceec
Confidence 631 1247889999987 4779862 77889999998776 99999999976221 2234
Q ss_pred ccEEEeCCCCcEeecC---CCCccccccccceecCCCEEEEecCCCCC
Q 043369 372 NPVIYCPKINRFRILS---PSLIPRLYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 372 ~~e~YDP~t~~Wt~~a---~~~~~R~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
.+.++|-.+.+|..+. ..+.+|++|+.++. .-.+++.||....
T Consensus 242 D~~~ldl~~~~W~~~~~~g~~p~~R~~h~~~~~--~~~~~l~gG~~~~ 287 (482)
T KOG0379|consen 242 DVHILDLSTWEWKLLPTGGDLPSPRSGHSLTVS--GDHLLLFGGGTDP 287 (482)
T ss_pred ceEeeecccceeeeccccCCCCCCcceeeeEEE--CCEEEEEcCCccc
Confidence 6889999999998654 57899999998754 7788888887664
No 26
>KOG4152 consensus Host cell transcription factor HCFC1 [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.33 E-value=4.7e-11 Score=122.75 Aligned_cols=276 Identities=13% Similarity=0.112 Sum_probs=170.5
Q ss_pred cEEeCcc----CCccccccceEcCCCcEEEEcCCCCC-ccEEEEEcCCCCCCccccc-CCCCCcccccceeEEecCCcEE
Q 043369 96 KVRPLTI----QTDTWCSSGALLANGVLVQTGGYRLG-ERVVRYLKPCSDCDWEEDH-QNGLISPRWYASNQILPNGKII 169 (526)
Q Consensus 96 ~w~~~~~----~~~~fc~~~~~l~~G~l~v~GG~~~g-~~~v~~ydp~~t~~W~~~~-~~~m~~~R~y~s~~~L~dG~v~ 169 (526)
.|+.+.. .+..+...-++....-|+|+||-++| .+...+|+.. +++|..-. -.+.+.+-.-++.+.+ +.|||
T Consensus 18 rWrrV~~~tGPvPrpRHGHRAVaikELiviFGGGNEGiiDELHvYNTa-tnqWf~PavrGDiPpgcAA~Gfvcd-Gtril 95 (830)
T KOG4152|consen 18 RWRRVQQSTGPVPRPRHGHRAVAIKELIVIFGGGNEGIIDELHVYNTA-TNQWFAPAVRGDIPPGCAAFGFVCD-GTRIL 95 (830)
T ss_pred ceEEEecccCCCCCccccchheeeeeeEEEecCCcccchhhhhhhccc-cceeecchhcCCCCCchhhcceEec-CceEE
Confidence 5665542 23445555666778889999998777 4788899999 99997530 0256655555566656 67999
Q ss_pred EEcCccC---CeEEEE-cCCCCCCCcceeec-CCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEeccCC----
Q 043369 170 VVGGRFQ---FTYEFI-PRTSDSDRKILYQL-PFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDYVNN---- 240 (526)
Q Consensus 170 viGG~~~---~~~E~y-P~~~~~~~~~w~~~-p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp~t~---- 240 (526)
++||+-. .+-|.| -+..+| .|..+ |-... ... .++..--|.|.+...|-|+|||-.-+.=||++|
T Consensus 96 vFGGMvEYGkYsNdLYELQasRW---eWkrlkp~~p~-nG~--pPCPRlGHSFsl~gnKcYlFGGLaNdseDpknNvPrY 169 (830)
T KOG4152|consen 96 VFGGMVEYGKYSNDLYELQASRW---EWKRLKPKTPK-NGP--PPCPRLGHSFSLVGNKCYLFGGLANDSEDPKNNVPRY 169 (830)
T ss_pred EEccEeeeccccchHHHhhhhhh---hHhhcCCCCCC-CCC--CCCCccCceeEEeccEeEEeccccccccCcccccchh
Confidence 9999854 234556 444445 66544 22111 111 234445577888899999999933222233222
Q ss_pred ----------------eEEEeccCC--CCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCch
Q 043369 241 ----------------RVMKNYPVM--PGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNEN 302 (526)
Q Consensus 241 ----------------~w~~~~p~~--p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~ 302 (526)
.|. +|.. +.+.+|. ++.+|+.- ..+.-..|++|.||...
T Consensus 170 LnDlY~leL~~Gsgvv~W~--ip~t~Gv~P~pRE---SHTAViY~-------------eKDs~~skmvvyGGM~G----- 226 (830)
T KOG4152|consen 170 LNDLYILELRPGSGVVAWD--IPITYGVLPPPRE---SHTAVIYT-------------EKDSKKSKMVVYGGMSG----- 226 (830)
T ss_pred hcceEEEEeccCCceEEEe--cccccCCCCCCcc---cceeEEEE-------------eccCCcceEEEEccccc-----
Confidence 343 2221 2222454 45566532 12334679999999862
Q ss_pred hhhhhcccccccceEEEEeecCCCCceec----ccCccccccceEEeCCCcEEEEcCcCC--C----CCCccCCCCCccc
Q 043369 303 AAEAQIFLPAAKSCGRLTITAQNPKWEME----EMPLNRVMGDMILLPTGDVLIINGAAK--G----TAGWGAAREPVLN 372 (526)
Q Consensus 303 ~~~~~~~~~a~~s~~~~d~~~~~~~W~~~----~M~~~R~~~~~vvLpdG~V~vvGG~~~--g----~~g~~~~~~~~~~ 372 (526)
..+.....+|+. +-.|... --|.+|+.|.++++ .+|+||+||.-- + .+.-..+=....+
T Consensus 227 --------~RLgDLW~Ldl~--Tl~W~kp~~~G~~PlPRSLHsa~~I-GnKMyvfGGWVPl~~~~~~~~~hekEWkCTss 295 (830)
T KOG4152|consen 227 --------CRLGDLWTLDLD--TLTWNKPSLSGVAPLPRSLHSATTI-GNKMYVFGGWVPLVMDDVKVATHEKEWKCTSS 295 (830)
T ss_pred --------ccccceeEEecc--eeecccccccCCCCCCcccccceee-cceeEEecceeeeeccccccccccceeeeccc
Confidence 235566677875 4778752 45678999998765 999999999621 0 0000000011234
Q ss_pred cEEEeCCCCcEeecC-------CCCccccccccceecCCCEEEEecCCCC
Q 043369 373 PVIYCPKINRFRILS-------PSLIPRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 373 ~e~YDP~t~~Wt~~a-------~~~~~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
.-++|-++.+|+.+- ..+.+|..|+++.+ +-|+|+=-|.+.
T Consensus 296 l~clNldt~~W~tl~~d~~ed~tiPR~RAGHCAvAi--gtRlYiWSGRDG 343 (830)
T KOG4152|consen 296 LACLNLDTMAWETLLMDTLEDNTIPRARAGHCAVAI--GTRLYIWSGRDG 343 (830)
T ss_pred eeeeeecchheeeeeeccccccccccccccceeEEe--ccEEEEEeccch
Confidence 578999999998642 25677889987666 889999888653
No 27
>KOG1230 consensus Protein containing repeated kelch motifs [General function prediction only]
Probab=99.24 E-value=1.5e-10 Score=116.74 Aligned_cols=218 Identities=18% Similarity=0.248 Sum_probs=148.3
Q ss_pred CcEEEEcCCC-CCc-----cEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEEEcCCCCCCC
Q 043369 117 GVLVQTGGYR-LGE-----RVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFIPRTSDSDR 190 (526)
Q Consensus 117 G~l~v~GG~~-~g~-----~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~yP~~~~~~~ 190 (526)
..|+++||.. +|. +....||.. +++|..+....-+.||..|.+++.+.|.+++.||.... |...
T Consensus 79 eELilfGGEf~ngqkT~vYndLy~Yn~k-~~eWkk~~spn~P~pRsshq~va~~s~~l~~fGGEfaS-----Pnq~---- 148 (521)
T KOG1230|consen 79 EELILFGGEFYNGQKTHVYNDLYSYNTK-KNEWKKVVSPNAPPPRSSHQAVAVPSNILWLFGGEFAS-----PNQE---- 148 (521)
T ss_pred ceeEEecceeecceeEEEeeeeeEEecc-ccceeEeccCCCcCCCccceeEEeccCeEEEeccccCC-----cchh----
Confidence 4889999953 332 456778888 99999873334567899999999998999999994320 2211
Q ss_pred cceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEeccCCeEEEeccCCCCCCCCccCCCCceeeccccc
Q 043369 191 KILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNL 270 (526)
Q Consensus 191 ~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~ 270 (526)
. ...| .+.|+||.++++|++ +..--.+.+|+ |.- |+
T Consensus 149 -----------q-------F~HY----------------kD~W~fd~~trkweq-l~~~g~PS~RS----GHR-Mv---- 184 (521)
T KOG1230|consen 149 -----------Q-------FHHY----------------KDLWLFDLKTRKWEQ-LEFGGGPSPRS----GHR-MV---- 184 (521)
T ss_pred -----------h-------hhhh----------------hheeeeeeccchhee-eccCCCCCCCc----cce-eE----
Confidence 0 0112 246889999999995 53222233453 432 22
Q ss_pred ccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec----ccCccccccceEEeC
Q 043369 271 SSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME----EMPLNRVMGDMILLP 346 (526)
Q Consensus 271 ~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~----~M~~~R~~~~~vvLp 346 (526)
.+..+|+++||... .... ..-.+.+++||+. +=+|+.. .-|.+|+.+++.+.|
T Consensus 185 -------------awK~~lilFGGFhd-~nr~-------y~YyNDvy~FdLd--tykW~Klepsga~PtpRSGcq~~vtp 241 (521)
T KOG1230|consen 185 -------------AWKRQLILFGGFHD-SNRD-------YIYYNDVYAFDLD--TYKWSKLEPSGAGPTPRSGCQFSVTP 241 (521)
T ss_pred -------------EeeeeEEEEcceec-CCCc-------eEEeeeeEEEecc--ceeeeeccCCCCCCCCCCcceEEecC
Confidence 16899999999742 1111 2347889999986 5889873 348999999999999
Q ss_pred CCcEEEEcCcCCCCCCccCCCC--CccccEEEeCCCC-----cEeecCC---CCccccccccceecCCCEEEEecCC
Q 043369 347 TGDVLIINGAAKGTAGWGAARE--PVLNPVIYCPKIN-----RFRILSP---SLIPRLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 347 dG~V~vvGG~~~g~~g~~~~~~--~~~~~e~YDP~t~-----~Wt~~a~---~~~~R~yhs~a~LlpdG~V~v~GG~ 413 (526)
+|.|+|.||+++-..- .+.+. ......+-+|+++ .|+.+-+ -+.||...|+++ -++++-|.+||-
T Consensus 242 qg~i~vyGGYsK~~~k-K~~dKG~~hsDmf~L~p~~~~~dKw~W~kvkp~g~kPspRsgfsv~v-a~n~kal~FGGV 316 (521)
T KOG1230|consen 242 QGGIVVYGGYSKQRVK-KDVDKGTRHSDMFLLKPEDGREDKWVWTKVKPSGVKPSPRSGFSVAV-AKNHKALFFGGV 316 (521)
T ss_pred CCcEEEEcchhHhhhh-hhhhcCceeeeeeeecCCcCCCcceeEeeccCCCCCCCCCCceeEEE-ecCCceEEecce
Confidence 9999999998642110 00011 1123566777773 7888766 478999999765 589999999994
No 28
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=99.00 E-value=5.3e-09 Score=102.00 Aligned_cols=133 Identities=23% Similarity=0.366 Sum_probs=88.1
Q ss_pred eEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccc
Q 043369 232 AILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLP 311 (526)
Q Consensus 232 ~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~ 311 (526)
+.+||+.++++. .+.. +.. .+ .++.++|| +|++++.||...+
T Consensus 48 s~~yD~~tn~~r-pl~v-~td---~F--CSgg~~L~------------------dG~ll~tGG~~~G------------- 89 (243)
T PF07250_consen 48 SVEYDPNTNTFR-PLTV-QTD---TF--CSGGAFLP------------------DGRLLQTGGDNDG------------- 89 (243)
T ss_pred EEEEecCCCcEE-eccC-CCC---Cc--ccCcCCCC------------------CCCEEEeCCCCcc-------------
Confidence 568999999986 4432 221 22 23344554 8999999997532
Q ss_pred cccceEEEEeec--CCCCceec--ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC-----c
Q 043369 312 AAKSCGRLTITA--QNPKWEME--EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN-----R 382 (526)
Q Consensus 312 a~~s~~~~d~~~--~~~~W~~~--~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~-----~ 382 (526)
.+.+..|+|.. ....|.+. .|..+|.+.+++.|+||+|+|+||... + +.|.|++... .
T Consensus 90 -~~~ir~~~p~~~~~~~~w~e~~~~m~~~RWYpT~~~L~DG~vlIvGG~~~----------~--t~E~~P~~~~~~~~~~ 156 (243)
T PF07250_consen 90 -NKAIRIFTPCTSDGTCDWTESPNDMQSGRWYPTATTLPDGRVLIVGGSNN----------P--TYEFWPPKGPGPGPVT 156 (243)
T ss_pred -ccceEEEecCCCCCCCCceECcccccCCCccccceECCCCCEEEEeCcCC----------C--cccccCCccCCCCcee
Confidence 23445577642 23579874 699999999999999999999999762 1 3476665332 3
Q ss_pred EeecCCC--CccccccccceecCCCEEEEecCCCC
Q 043369 383 FRILSPS--LIPRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 383 Wt~~a~~--~~~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
|..+... ..+..+.-...|||||+||+.+....
T Consensus 157 ~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~s 191 (243)
T PF07250_consen 157 LPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRGS 191 (243)
T ss_pred eecchhhhccCccccCceEEEcCCCCEEEEEcCCc
Confidence 3333221 34445444578899999999998643
No 29
>COG3055 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=98.97 E-value=1e-07 Score=95.45 Aligned_cols=262 Identities=20% Similarity=0.225 Sum_probs=157.7
Q ss_pred eCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCC-cccccceeEEecCCcEEEEcCccC
Q 043369 99 PLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLI-SPRWYASNQILPNGKIIVVGGRFQ 176 (526)
Q Consensus 99 ~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~-~~R~y~s~~~L~dG~v~viGG~~~ 176 (526)
++|.++..+-.+...+.+..+||-=|.. | .+-...|..+ ...|++. +..+ .+|-.+..+++ +|++||.||...
T Consensus 29 ~lPdlPvg~KnG~Ga~ig~~~YVGLGs~-G-~afy~ldL~~~~k~W~~~--a~FpG~~rnqa~~a~~-~~kLyvFgG~Gk 103 (381)
T COG3055 29 QLPDLPVGFKNGAGALIGDTVYVGLGSA-G-TAFYVLDLKKPGKGWTKI--ADFPGGARNQAVAAVI-GGKLYVFGGYGK 103 (381)
T ss_pred cCCCCCccccccccceecceEEEEeccC-C-ccceehhhhcCCCCceEc--ccCCCcccccchheee-CCeEEEeecccc
Confidence 4455555666666666666888754532 1 2223334332 5789998 4544 56866666666 999999999742
Q ss_pred ---------CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCC-cEEEEEcc---------------
Q 043369 177 ---------FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDG-NLFIFAND--------------- 230 (526)
Q Consensus 177 ---------~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG-~Iy~~Gg~--------------- 230 (526)
..+-+| |.++ +|..++....+ .+--+....+++ +|+++||.
T Consensus 104 ~~~~~~~~~nd~Y~y~p~~n-----sW~kl~t~sP~--------gl~G~~~~~~~~~~i~f~GGvn~~if~~yf~dv~~a 170 (381)
T COG3055 104 SVSSSPQVFNDAYRYDPSTN-----SWHKLDTRSPT--------GLVGASTFSLNGTKIYFFGGVNQNIFNGYFEDVGAA 170 (381)
T ss_pred CCCCCceEeeeeEEecCCCC-----hhheecccccc--------ccccceeEecCCceEEEEccccHHhhhhhHHhhhhh
Confidence 134467 8888 77655432221 111233444555 99999982
Q ss_pred --------------------------ceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCc
Q 043369 231 --------------------------RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPV 284 (526)
Q Consensus 231 --------------------------~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~ 284 (526)
....|||.++.|. .+-..| .++.+|++++.
T Consensus 171 ~~d~~~~~~i~~~yf~~~~~dy~~n~ev~sy~p~~n~W~-~~G~~p-----f~~~aGsa~~~------------------ 226 (381)
T COG3055 171 GKDKEAVDKIIAHYFDKKAEDYFFNKEVLSYDPSTNQWR-NLGENP-----FYGNAGSAVVI------------------ 226 (381)
T ss_pred cccHHHHHHHHHHHhCCCHHHhcccccccccccccchhh-hcCcCc-----ccCccCcceee------------------
Confidence 1457999999997 343334 35557777652
Q ss_pred cCcEEEEEcCCCCCCCchhhhhhcccccccc--eEEEEeecCCCCceec-ccCcccccc------ceEEeCCCcEEEEcC
Q 043369 285 VHSQVLICGGTLPDSNENAAEAQIFLPAAKS--CGRLTITAQNPKWEME-EMPLNRVMG------DMILLPTGDVLIING 355 (526)
Q Consensus 285 ~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s--~~~~d~~~~~~~W~~~-~M~~~R~~~------~~vvLpdG~V~vvGG 355 (526)
-+++|.++-|.-. |.+++ +.+++.....-+|... ++|.+-... ..---.+|.++|.||
T Consensus 227 ~~n~~~lInGEiK-------------pGLRt~~~k~~~~~~~~~~w~~l~~lp~~~~~~~eGvAGaf~G~s~~~~lv~GG 293 (381)
T COG3055 227 KGNKLTLINGEIK-------------PGLRTAEVKQADFGGDNLKWLKLSDLPAPIGSNKEGVAGAFSGKSNGEVLVAGG 293 (381)
T ss_pred cCCeEEEEcceec-------------CCccccceeEEEeccCceeeeeccCCCCCCCCCccccceeccceeCCeEEEecC
Confidence 3677888877531 23333 3457776556789875 555433211 111234899999999
Q ss_pred cCCCCC------CccCCCCC---ccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCCC
Q 043369 356 AAKGTA------GWGAAREP---VLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNVN 417 (526)
Q Consensus 356 ~~~g~~------g~~~~~~~---~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~~ 417 (526)
+..-.+ |.-.+.+. ...-|+|--+.+.|+.+..++.++.|-- .+.-.+.||++||+..++
T Consensus 294 AnF~Ga~~~y~~Gk~~AH~Gl~K~w~~~Vy~~d~g~Wk~~GeLp~~l~YG~--s~~~nn~vl~IGGE~~~G 362 (381)
T COG3055 294 ANFPGALKAYKNGKFYAHEGLSKSWNSEVYIFDNGSWKIVGELPQGLAYGV--SLSYNNKVLLIGGETSGG 362 (381)
T ss_pred CCChhHHHHHHhcccccccchhhhhhceEEEEcCCceeeecccCCCccceE--EEecCCcEEEEccccCCC
Confidence 863111 11012221 1234555555899999999999998863 344588899999986653
No 30
>COG3055 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=98.96 E-value=4.4e-08 Score=98.00 Aligned_cols=245 Identities=17% Similarity=0.224 Sum_probs=142.7
Q ss_pred CCcEEEcccCCcc-ceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCc
Q 043369 27 EGKWKLLKRSIGV-SAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTD 105 (526)
Q Consensus 27 ~g~W~~~~~~~~v-~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~ 105 (526)
.-.|+.+...++. +-..++...++|+|+++|..-..+ ..++ ....+..|||.+++|..+.+...
T Consensus 69 ~k~W~~~a~FpG~~rnqa~~a~~~~kLyvFgG~Gk~~~--~~~~-------------~~nd~Y~y~p~~nsW~kl~t~sP 133 (381)
T COG3055 69 GKGWTKIADFPGGARNQAVAAVIGGKLYVFGGYGKSVS--SSPQ-------------VFNDAYRYDPSTNSWHKLDTRSP 133 (381)
T ss_pred CCCceEcccCCCcccccchheeeCCeEEEeeccccCCC--CCce-------------EeeeeEEecCCCChhheeccccc
Confidence 3579988655544 334444567999999999853222 1110 13467899999999999986532
Q ss_pred -cccccceEcCCC-cEEEEcCCC----C--------------------------------CccEEEEEcCCCCCCccccc
Q 043369 106 -TWCSSGALLANG-VLVQTGGYR----L--------------------------------GERVVRYLKPCSDCDWEEDH 147 (526)
Q Consensus 106 -~fc~~~~~l~~G-~l~v~GG~~----~--------------------------------g~~~v~~ydp~~t~~W~~~~ 147 (526)
..-...++..++ +|+++||.. + -.+.+..|||+ ++.|..+
T Consensus 134 ~gl~G~~~~~~~~~~i~f~GGvn~~if~~yf~dv~~a~~d~~~~~~i~~~yf~~~~~dy~~n~ev~sy~p~-~n~W~~~- 211 (381)
T COG3055 134 TGLVGASTFSLNGTKIYFFGGVNQNIFNGYFEDVGAAGKDKEAVDKIIAHYFDKKAEDYFFNKEVLSYDPS-TNQWRNL- 211 (381)
T ss_pred cccccceeEecCCceEEEEccccHHhhhhhHHhhhhhcccHHHHHHHHHHHhCCCHHHhcccccccccccc-cchhhhc-
Confidence 233334444555 999999952 0 02457789999 9999987
Q ss_pred CCCCC-cccccceeEEecCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEE
Q 043369 148 QNGLI-SPRWYASNQILPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFI 226 (526)
Q Consensus 148 ~~~m~-~~R~y~s~~~L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~ 226 (526)
...+ .++.. ++++..++++.+|-| |++|-..+ .|.. .+
T Consensus 212 -G~~pf~~~aG-sa~~~~~n~~~lInG------EiKpGLRt----~~~k----------------------------~~- 250 (381)
T COG3055 212 -GENPFYGNAG-SAVVIKGNKLTLING------EIKPGLRT----AEVK----------------------------QA- 250 (381)
T ss_pred -CcCcccCccC-cceeecCCeEEEEcc------eecCCccc----ccee----------------------------EE-
Confidence 4444 45654 455566788888877 34432210 1110 00
Q ss_pred EEccceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCC-CCCchhhh
Q 043369 227 FANDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLP-DSNENAAE 305 (526)
Q Consensus 227 ~Gg~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~-~~~~~~~~ 305 (526)
.|.-..-+|. .++.+|... .....|.+-- -..+.++++++.||+.- ++-.+-.+
T Consensus 251 -------~~~~~~~~w~-~l~~lp~~~--~~~~eGvAGa---------------f~G~s~~~~lv~GGAnF~Ga~~~y~~ 305 (381)
T COG3055 251 -------DFGGDNLKWL-KLSDLPAPI--GSNKEGVAGA---------------FSGKSNGEVLVAGGANFPGALKAYKN 305 (381)
T ss_pred -------EeccCceeee-eccCCCCCC--CCCcccccee---------------ccceeCCeEEEecCCCChhHHHHHHh
Confidence 1122234676 466666542 1111222211 12346899999999752 11111011
Q ss_pred hhc-cccc-----ccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCC
Q 043369 306 AQI-FLPA-----AKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKG 359 (526)
Q Consensus 306 ~~~-~~~a-----~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g 359 (526)
+.+ +.+. .+.+..+| ++.|+.. .||.++.++.++.. +++||++||...+
T Consensus 306 Gk~~AH~Gl~K~w~~~Vy~~d----~g~Wk~~GeLp~~l~YG~s~~~-nn~vl~IGGE~~~ 361 (381)
T COG3055 306 GKFYAHEGLSKSWNSEVYIFD----NGSWKIVGELPQGLAYGVSLSY-NNKVLLIGGETSG 361 (381)
T ss_pred cccccccchhhhhhceEEEEc----CCceeeecccCCCccceEEEec-CCcEEEEccccCC
Confidence 111 0111 23344444 5899986 99999999876654 8899999998643
No 31
>KOG1230 consensus Protein containing repeated kelch motifs [General function prediction only]
Probab=98.96 E-value=1.1e-08 Score=103.63 Aligned_cols=193 Identities=18% Similarity=0.251 Sum_probs=131.6
Q ss_pred CCcEEEcc-cC-CccceeEEE-EecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccC
Q 043369 27 EGKWKLLK-RS-IGVSAMHMA-LLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQ 103 (526)
Q Consensus 27 ~g~W~~~~-~~-~~v~~~~~a-~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~ 103 (526)
..+|..+. ++ ++.+..|.+ +.+.|.++++||--..+.+. +|.|+....+||.+|++|+++...
T Consensus 107 ~~eWkk~~spn~P~pRsshq~va~~s~~l~~fGGEfaSPnq~--------------qF~HYkD~W~fd~~trkweql~~~ 172 (521)
T KOG1230|consen 107 KNEWKKVVSPNAPPPRSSHQAVAVPSNILWLFGGEFASPNQE--------------QFHHYKDLWLFDLKTRKWEQLEFG 172 (521)
T ss_pred ccceeEeccCCCcCCCccceeEEeccCeEEEeccccCCcchh--------------hhhhhhheeeeeeccchheeeccC
Confidence 57899874 22 233444544 56789999999864323222 345677888999999999999854
Q ss_pred --CccccccceEcCCCcEEEEcCCCCC------ccEEEEEcCCCCCCcccccC-CCCCcccccceeEEecCCcEEEEcCc
Q 043369 104 --TDTWCSSGALLANGVLVQTGGYRLG------ERVVRYLKPCSDCDWEEDHQ-NGLISPRWYASNQILPNGKIIVVGGR 174 (526)
Q Consensus 104 --~~~fc~~~~~l~~G~l~v~GG~~~g------~~~v~~ydp~~t~~W~~~~~-~~m~~~R~y~s~~~L~dG~v~viGG~ 174 (526)
+..+...-.++.-.+++++||+.+. .+.+.+||.. +-+|+.+.+ ..-+.+|..+...+.++|.|||.||.
T Consensus 173 g~PS~RSGHRMvawK~~lilFGGFhd~nr~y~YyNDvy~FdLd-tykW~Klepsga~PtpRSGcq~~vtpqg~i~vyGGY 251 (521)
T KOG1230|consen 173 GGPSPRSGHRMVAWKRQLILFGGFHDSNRDYIYYNDVYAFDLD-TYKWSKLEPSGAGPTPRSGCQFSVTPQGGIVVYGGY 251 (521)
T ss_pred CCCCCCccceeEEeeeeEEEEcceecCCCceEEeeeeEEEecc-ceeeeeccCCCCCCCCCCcceEEecCCCcEEEEcch
Confidence 5566666677778999999998653 3678899999 999998733 12478999999999999999999997
Q ss_pred cC----C-------eEEEE---cCCC---CCCCcceeec-CCccccCCCCCCCCCCcceEEEecCCcEEEEEcc------
Q 043369 175 FQ----F-------TYEFI---PRTS---DSDRKILYQL-PFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND------ 230 (526)
Q Consensus 175 ~~----~-------~~E~y---P~~~---~~~~~~w~~~-p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~------ 230 (526)
.. + ....| |..+ .| .|..+ |.-... .++.-|. +.+.++++-+.|||-
T Consensus 252 sK~~~kK~~dKG~~hsDmf~L~p~~~~~dKw---~W~kvkp~g~kP-----spRsgfs-v~va~n~kal~FGGV~D~eee 322 (521)
T KOG1230|consen 252 SKQRVKKDVDKGTRHSDMFLLKPEDGREDKW---VWTKVKPSGVKP-----SPRSGFS-VAVAKNHKALFFGGVCDLEEE 322 (521)
T ss_pred hHhhhhhhhhcCceeeeeeeecCCcCCCcce---eEeeccCCCCCC-----CCCCcee-EEEecCCceEEecceeccccc
Confidence 42 1 12233 5542 24 56544 321111 1233332 456779999999992
Q ss_pred ----------ceEEEeccCCeEE
Q 043369 231 ----------RAILLDYVNNRVM 243 (526)
Q Consensus 231 ----------~~~~yDp~t~~w~ 243 (526)
+...||...|+|.
T Consensus 323 eEsl~g~F~NDLy~fdlt~nrW~ 345 (521)
T KOG1230|consen 323 EESLSGEFFNDLYFFDLTRNRWS 345 (521)
T ss_pred chhhhhhhhhhhhheecccchhh
Confidence 2346899999997
No 32
>PF13964 Kelch_6: Kelch motif
Probab=98.93 E-value=1.9e-09 Score=79.11 Aligned_cols=50 Identities=20% Similarity=0.341 Sum_probs=42.0
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccc
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPR 393 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R 393 (526)
+|..++++++ +++|||+||.... ......+|+|||++++|+.+++|+.||
T Consensus 1 pR~~~s~v~~-~~~iyv~GG~~~~-------~~~~~~v~~yd~~t~~W~~~~~mp~pR 50 (50)
T PF13964_consen 1 PRYGHSAVVV-GGKIYVFGGYDNS-------GKYSNDVERYDPETNTWEQLPPMPTPR 50 (50)
T ss_pred CCccCEEEEE-CCEEEEECCCCCC-------CCccccEEEEcCCCCcEEECCCCCCCC
Confidence 5888887765 9999999998631 234568999999999999999999998
No 33
>KOG4152 consensus Host cell transcription factor HCFC1 [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=98.90 E-value=1.8e-08 Score=104.01 Aligned_cols=220 Identities=16% Similarity=0.239 Sum_probs=136.5
Q ss_pred CCCcccccceeEEecCCcEEEEcCccCC---eEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEE
Q 043369 150 GLISPRWYASNQILPNGKIIVVGGRFQF---TYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLF 225 (526)
Q Consensus 150 ~m~~~R~y~s~~~L~dG~v~viGG~~~~---~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy 225 (526)
+-+.+|..|-++++ .--|.|+||-+.. ...+| ..++ +|. +|..+. | .+-..-+|.+++...+||
T Consensus 28 PvPrpRHGHRAVai-kELiviFGGGNEGiiDELHvYNTatn-----qWf-~PavrG--D---iPpgcAA~GfvcdGtril 95 (830)
T KOG4152|consen 28 PVPRPRHGHRAVAI-KELIVIFGGGNEGIIDELHVYNTATN-----QWF-APAVRG--D---IPPGCAAFGFVCDGTRIL 95 (830)
T ss_pred CCCCccccchheee-eeeEEEecCCcccchhhhhhhccccc-----eee-cchhcC--C---CCCchhhcceEecCceEE
Confidence 57788998988888 5678888887753 45567 7776 553 222211 1 011122345677677999
Q ss_pred EEEcc------ceEEEeccCCeEEE-ec-cCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCC
Q 043369 226 IFAND------RAILLDYVNNRVMK-NY-PVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLP 297 (526)
Q Consensus 226 ~~Gg~------~~~~yDp~t~~w~~-~~-p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~ 297 (526)
+|||- +-++|.....+|+. .+ |..|-+-+--+|.-|.+-.| +..|-|++||..+
T Consensus 96 vFGGMvEYGkYsNdLYELQasRWeWkrlkp~~p~nG~pPCPRlGHSFsl------------------~gnKcYlFGGLaN 157 (830)
T KOG4152|consen 96 VFGGMVEYGKYSNDLYELQASRWEWKRLKPKTPKNGPPPCPRLGHSFSL------------------VGNKCYLFGGLAN 157 (830)
T ss_pred EEccEeeeccccchHHHhhhhhhhHhhcCCCCCCCCCCCCCccCceeEE------------------eccEeEEeccccc
Confidence 99993 34566666666642 12 22221111112223443322 4789999999864
Q ss_pred CCCchhhhhhcccccccceEEEEeecCCC--Ccee----cccCccccccceEEeC-----CCcEEEEcCcCCCCCCccCC
Q 043369 298 DSNENAAEAQIFLPAAKSCGRLTITAQNP--KWEM----EEMPLNRVMGDMILLP-----TGDVLIINGAAKGTAGWGAA 366 (526)
Q Consensus 298 ~~~~~~~~~~~~~~a~~s~~~~d~~~~~~--~W~~----~~M~~~R~~~~~vvLp-----dG~V~vvGG~~~g~~g~~~~ 366 (526)
+ ..++.++. ..-++..+.+++..... .|+. ..+|.+|..|.+|+.- .-|++|.||.+ |..
T Consensus 158 d-seDpknNv--PrYLnDlY~leL~~Gsgvv~W~ip~t~Gv~P~pRESHTAViY~eKDs~~skmvvyGGM~-G~R----- 228 (830)
T KOG4152|consen 158 D-SEDPKNNV--PRYLNDLYILELRPGSGVVAWDIPITYGVLPPPRESHTAVIYTEKDSKKSKMVVYGGMS-GCR----- 228 (830)
T ss_pred c-ccCccccc--chhhcceEEEEeccCCceEEEecccccCCCCCCcccceeEEEEeccCCcceEEEEcccc-ccc-----
Confidence 3 22221111 12367777777764332 4885 2899999999998862 24899999987 432
Q ss_pred CCCccccEEEeCCCCcEeec---CCCCccccccccceecCCCEEEEecCC
Q 043369 367 REPVLNPVIYCPKINRFRIL---SPSLIPRLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 367 ~~~~~~~e~YDP~t~~Wt~~---a~~~~~R~yhs~a~LlpdG~V~v~GG~ 413 (526)
+-....-|-+|-.|++. .-.+.||.-||+.++ ..|.||.||-
T Consensus 229 ---LgDLW~Ldl~Tl~W~kp~~~G~~PlPRSLHsa~~I--GnKMyvfGGW 273 (830)
T KOG4152|consen 229 ---LGDLWTLDLDTLTWNKPSLSGVAPLPRSLHSATTI--GNKMYVFGGW 273 (830)
T ss_pred ---ccceeEEecceeecccccccCCCCCCcccccceee--cceeEEecce
Confidence 22456677777788753 234668999997776 9999999994
No 34
>PF01344 Kelch_1: Kelch motif; InterPro: IPR006652 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding; PDB: 2XN4_A 2WOZ_A 3II7_A 4ASC_A 1U6D_X 1ZGK_A 2FLU_X 2VPJ_A 2DYH_A 1X2R_A ....
Probab=98.57 E-value=4.6e-08 Score=70.57 Aligned_cols=47 Identities=19% Similarity=0.353 Sum_probs=38.4
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCC
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSL 390 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~ 390 (526)
+|..++++++ +++|||+||... ......++|+|||.+++|+.+++|+
T Consensus 1 pR~~~~~~~~-~~~iyv~GG~~~-------~~~~~~~v~~yd~~~~~W~~~~~mp 47 (47)
T PF01344_consen 1 PRSGHAAVVV-GNKIYVIGGYDG-------NNQPTNSVEVYDPETNTWEELPPMP 47 (47)
T ss_dssp -BBSEEEEEE-TTEEEEEEEBES-------TSSBEEEEEEEETTTTEEEEEEEES
T ss_pred CCccCEEEEE-CCEEEEEeeecc-------cCceeeeEEEEeCCCCEEEEcCCCC
Confidence 5888887776 999999999873 1235668999999999999999885
No 35
>smart00612 Kelch Kelch domain.
Probab=98.56 E-value=7.8e-08 Score=68.85 Aligned_cols=45 Identities=20% Similarity=0.366 Sum_probs=37.7
Q ss_pred cEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCcccccccccee
Q 043369 349 DVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHL 401 (526)
Q Consensus 349 ~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~L 401 (526)
+|||+||... .....++|+|||.+++|+.+++|+.+|.+|+++++
T Consensus 1 ~iyv~GG~~~--------~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~ 45 (47)
T smart00612 1 KIYVVGGFDG--------GQRLKSVEVYDPETNKWTPLPSMPTPRSGHGVAVI 45 (47)
T ss_pred CEEEEeCCCC--------CceeeeEEEECCCCCeEccCCCCCCccccceEEEe
Confidence 5899999752 12345789999999999999999999999987765
No 36
>PF13964 Kelch_6: Kelch motif
Probab=98.28 E-value=1.1e-06 Score=64.39 Aligned_cols=46 Identities=24% Similarity=0.375 Sum_probs=39.8
Q ss_pred ccccceEcCCCcEEEEcCCCC---CccEEEEEcCCCCCCcccccCCCCCccc
Q 043369 107 WCSSGALLANGVLVQTGGYRL---GERVVRYLKPCSDCDWEEDHQNGLISPR 155 (526)
Q Consensus 107 fc~~~~~l~~G~l~v~GG~~~---g~~~v~~ydp~~t~~W~~~~~~~m~~~R 155 (526)
+|..+++..+++||++||..+ ..+.+++|||. +++|+.+ .+|+.+|
T Consensus 2 R~~~s~v~~~~~iyv~GG~~~~~~~~~~v~~yd~~-t~~W~~~--~~mp~pR 50 (50)
T PF13964_consen 2 RYGHSAVVVGGKIYVFGGYDNSGKYSNDVERYDPE-TNTWEQL--PPMPTPR 50 (50)
T ss_pred CccCEEEEECCEEEEECCCCCCCCccccEEEEcCC-CCcEEEC--CCCCCCC
Confidence 466677888999999999865 25899999999 9999999 6899988
No 37
>PF13418 Kelch_4: Galactose oxidase, central domain; PDB: 2UVK_B.
Probab=98.22 E-value=1e-06 Score=64.18 Aligned_cols=48 Identities=13% Similarity=0.189 Sum_probs=30.0
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCC
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSL 390 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~ 390 (526)
+|..|+++.+.+++|||+||.... ......+++||+++++|+++++||
T Consensus 1 pR~~h~~~~~~~~~i~v~GG~~~~-------~~~~~d~~~~d~~~~~W~~~~~~P 48 (49)
T PF13418_consen 1 PRYGHSAVSIGDNSIYVFGGRDSS-------GSPLNDLWIFDIETNTWTRLPSMP 48 (49)
T ss_dssp --BS-EEEEE-TTEEEEE--EEE--------TEE---EEEEETTTTEEEE--SS-
T ss_pred CcceEEEEEEeCCeEEEECCCCCC-------CcccCCEEEEECCCCEEEECCCCC
Confidence 689999988878999999998631 124557899999999999998776
No 38
>PF07646 Kelch_2: Kelch motif; InterPro: IPR011498 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding
Probab=98.13 E-value=4.9e-06 Score=60.64 Aligned_cols=49 Identities=14% Similarity=0.234 Sum_probs=35.8
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCC
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSL 390 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~ 390 (526)
+|..|.+++ +|+||||+||...+. .......+++||+++++|+.+++|+
T Consensus 1 ~r~~hs~~~-~~~kiyv~GG~~~~~-----~~~~~~~v~~~d~~t~~W~~~~~~g 49 (49)
T PF07646_consen 1 PRYGHSAVV-LDGKIYVFGGYGTDN-----GGSSSNDVWVFDTETNQWTELSPMG 49 (49)
T ss_pred CccceEEEE-ECCEEEEECCcccCC-----CCcccceeEEEECCCCEEeecCCCC
Confidence 477777555 599999999981111 1223446899999999999998874
No 39
>PF13415 Kelch_3: Galactose oxidase, central domain
Probab=98.11 E-value=4.5e-06 Score=60.86 Aligned_cols=48 Identities=10% Similarity=0.151 Sum_probs=39.2
Q ss_pred CCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccccccce
Q 043369 347 TGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAH 400 (526)
Q Consensus 347 dG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~ 400 (526)
+++|||+||.... ......++.+||+.+++|+++++++.+|..|++++
T Consensus 1 g~~~~vfGG~~~~------~~~~~nd~~~~~~~~~~W~~~~~~P~~R~~h~~~~ 48 (49)
T PF13415_consen 1 GNKLYVFGGYDDD------GGTRLNDVWVFDLDTNTWTRIGDLPPPRSGHTATV 48 (49)
T ss_pred CCEEEEECCcCCC------CCCEecCEEEEECCCCEEEECCCCCCCccceEEEE
Confidence 5789999998721 12344578999999999999999999999999764
No 40
>smart00612 Kelch Kelch domain.
Probab=98.08 E-value=7.3e-06 Score=58.43 Aligned_cols=43 Identities=16% Similarity=0.276 Sum_probs=37.3
Q ss_pred cEEEEcCCCC--CccEEEEEcCCCCCCcccccCCCCCcccccceeEEe
Q 043369 118 VLVQTGGYRL--GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQIL 163 (526)
Q Consensus 118 ~l~v~GG~~~--g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L 163 (526)
+||++||... ..+.+++|||. +++|.+. .+|+.+|.+++++++
T Consensus 1 ~iyv~GG~~~~~~~~~v~~yd~~-~~~W~~~--~~~~~~r~~~~~~~~ 45 (47)
T smart00612 1 KIYVVGGFDGGQRLKSVEVYDPE-TNKWTPL--PSMPTPRSGHGVAVI 45 (47)
T ss_pred CEEEEeCCCCCceeeeEEEECCC-CCeEccC--CCCCCccccceEEEe
Confidence 5899999853 25789999999 9999998 589999999998887
No 41
>PF13415 Kelch_3: Galactose oxidase, central domain
Probab=97.51 E-value=0.00015 Score=52.77 Aligned_cols=44 Identities=23% Similarity=0.256 Sum_probs=37.7
Q ss_pred CCcEEEEcCCCC-C---ccEEEEEcCCCCCCcccccCCCCCcccccceeEE
Q 043369 116 NGVLVQTGGYRL-G---ERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQI 162 (526)
Q Consensus 116 ~G~l~v~GG~~~-g---~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~ 162 (526)
+++|||+||... + .+.+..||+. +.+|+++ .+++.+|..|++++
T Consensus 1 g~~~~vfGG~~~~~~~~~nd~~~~~~~-~~~W~~~--~~~P~~R~~h~~~~ 48 (49)
T PF13415_consen 1 GNKLYVFGGYDDDGGTRLNDVWVFDLD-TNTWTRI--GDLPPPRSGHTATV 48 (49)
T ss_pred CCEEEEECCcCCCCCCEecCEEEEECC-CCEEEEC--CCCCCCccceEEEE
Confidence 578999999872 2 4789999999 9999998 68999999998875
No 42
>PF01344 Kelch_1: Kelch motif; InterPro: IPR006652 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding; PDB: 2XN4_A 2WOZ_A 3II7_A 4ASC_A 1U6D_X 1ZGK_A 2FLU_X 2VPJ_A 2DYH_A 1X2R_A ....
Probab=97.50 E-value=3.3e-05 Score=55.45 Aligned_cols=43 Identities=21% Similarity=0.304 Sum_probs=35.5
Q ss_pred ccccceEcCCCcEEEEcCCCC---CccEEEEEcCCCCCCcccccCCCCC
Q 043369 107 WCSSGALLANGVLVQTGGYRL---GERVVRYLKPCSDCDWEEDHQNGLI 152 (526)
Q Consensus 107 fc~~~~~l~~G~l~v~GG~~~---g~~~v~~ydp~~t~~W~~~~~~~m~ 152 (526)
++..+++..+++||++||... ..+++++||+. +++|.++ ++|+
T Consensus 2 R~~~~~~~~~~~iyv~GG~~~~~~~~~~v~~yd~~-~~~W~~~--~~mp 47 (47)
T PF01344_consen 2 RSGHAAVVVGNKIYVIGGYDGNNQPTNSVEVYDPE-TNTWEEL--PPMP 47 (47)
T ss_dssp BBSEEEEEETTEEEEEEEBESTSSBEEEEEEEETT-TTEEEEE--EEES
T ss_pred CccCEEEEECCEEEEEeeecccCceeeeEEEEeCC-CCEEEEc--CCCC
Confidence 456677888999999999864 25799999999 9999998 4664
No 43
>PLN02772 guanylate kinase
Probab=97.45 E-value=0.00038 Score=72.45 Aligned_cols=71 Identities=18% Similarity=0.173 Sum_probs=55.1
Q ss_pred cccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEee---cCCCCccccccccceecCCCEEEEecC
Q 043369 336 NRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRI---LSPSLIPRLYHSTAHLLSDGRVLVGGS 412 (526)
Q Consensus 336 ~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~---~a~~~~~R~yhs~a~LlpdG~V~v~GG 412 (526)
+|..+++++. ++++||+||.+.. ......+.+||+.+.+|+. ....|.||-.|| |+++.|.||||.++
T Consensus 24 ~~~~~tav~i-gdk~yv~GG~~d~-------~~~~~~v~i~D~~t~~W~~P~V~G~~P~~r~GhS-a~v~~~~rilv~~~ 94 (398)
T PLN02772 24 PKNRETSVTI-GDKTYVIGGNHEG-------NTLSIGVQILDKITNNWVSPIVLGTGPKPCKGYS-AVVLNKDRILVIKK 94 (398)
T ss_pred CCCcceeEEE-CCEEEEEcccCCC-------ccccceEEEEECCCCcEecccccCCCCCCCCcce-EEEECCceEEEEeC
Confidence 6777776665 9999999997621 1123468999999999985 467889999999 56668999999997
Q ss_pred CCC
Q 043369 413 NPN 415 (526)
Q Consensus 413 ~~~ 415 (526)
+..
T Consensus 95 ~~~ 97 (398)
T PLN02772 95 GSA 97 (398)
T ss_pred CCC
Confidence 543
No 44
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=97.45 E-value=0.13 Score=54.32 Aligned_cols=241 Identities=15% Similarity=0.156 Sum_probs=116.2
Q ss_pred eEEEEeCCCCc--EEeC-ccCC-------ccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCCcc
Q 043369 86 HAVEFDPITRK--VRPL-TIQT-------DTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLISP 154 (526)
Q Consensus 86 ~~~~yDp~t~~--w~~~-~~~~-------~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~~~ 154 (526)
....+|.++++ |+.- .... .....++.++.+++||+.+.. ..+..+|+.+ ...|+.. +...
T Consensus 80 ~l~ald~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~v~~~~v~v~~~~----g~l~ald~~tG~~~W~~~----~~~~ 151 (394)
T PRK11138 80 LVKALDADTGKEIWSVDLSEKDGWFSKNKSALLSGGVTVAGGKVYIGSEK----GQVYALNAEDGEVAWQTK----VAGE 151 (394)
T ss_pred eEEEEECCCCcEeeEEcCCCcccccccccccccccccEEECCEEEEEcCC----CEEEEEECCCCCCccccc----CCCc
Confidence 35677877765 6532 2111 112233455667888764432 3688899872 3468653 2211
Q ss_pred cccceeEEecCCcEEEEcCccCCeEEEE-cCCCCCCCcceee-cC--CccccCCCCCCCCCCcceEEEecCCcEEEEEcc
Q 043369 155 RWYASNQILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQ-LP--FLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND 230 (526)
Q Consensus 155 R~y~s~~~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~-~p--~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~ 230 (526)
- +.+. ++.+++||+..+. ..+..+ ++++. ..|.. .. .+... ...-| ++.+|.+|+..+.
T Consensus 152 ~-~ssP-~v~~~~v~v~~~~--g~l~ald~~tG~---~~W~~~~~~~~~~~~-------~~~sP---~v~~~~v~~~~~~ 214 (394)
T PRK11138 152 A-LSRP-VVSDGLVLVHTSN--GMLQALNESDGA---VKWTVNLDVPSLTLR-------GESAP---ATAFGGAIVGGDN 214 (394)
T ss_pred e-ecCC-EEECCEEEEECCC--CEEEEEEccCCC---EeeeecCCCCccccc-------CCCCC---EEECCEEEEEcCC
Confidence 1 2222 3448888875442 234445 65552 25643 11 11000 00112 2336677765433
Q ss_pred -ceEEEeccCCe--EEEeccCCCCCCC---CccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhh
Q 043369 231 -RAILLDYVNNR--VMKNYPVMPGGIS---RNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAA 304 (526)
Q Consensus 231 -~~~~yDp~t~~--w~~~~p~~p~~~~---r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~ 304 (526)
....+|+++++ |...+. .|.... |......+-+ ..++.||+++...
T Consensus 215 g~v~a~d~~~G~~~W~~~~~-~~~~~~~~~~~~~~~~sP~-------------------v~~~~vy~~~~~g-------- 266 (394)
T PRK11138 215 GRVSAVLMEQGQLIWQQRIS-QPTGATEIDRLVDVDTTPV-------------------VVGGVVYALAYNG-------- 266 (394)
T ss_pred CEEEEEEccCChhhheeccc-cCCCccchhcccccCCCcE-------------------EECCEEEEEEcCC--------
Confidence 34567888764 543221 111100 0000001111 1377888765321
Q ss_pred hhhcccccccceEEEEeecCCCCceecccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC--c
Q 043369 305 EAQIFLPAAKSCGRLTITAQNPKWEMEEMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN--R 382 (526)
Q Consensus 305 ~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~--~ 382 (526)
...++|+.+....|+.. ....+ . .++.+|+||+..... .+.++|+++. .
T Consensus 267 ----------~l~ald~~tG~~~W~~~-~~~~~---~-~~~~~~~vy~~~~~g--------------~l~ald~~tG~~~ 317 (394)
T PRK11138 267 ----------NLVALDLRSGQIVWKRE-YGSVN---D-FAVDGGRIYLVDQND--------------RVYALDTRGGVEL 317 (394)
T ss_pred ----------eEEEEECCCCCEEEeec-CCCcc---C-cEEECCEEEEEcCCC--------------eEEEEECCCCcEE
Confidence 24578876555668764 11111 2 233488999875321 4577888776 5
Q ss_pred EeecCCCCccccccccceecCCCEEEEecC
Q 043369 383 FRILSPSLIPRLYHSTAHLLSDGRVLVGGS 412 (526)
Q Consensus 383 Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG 412 (526)
|+.-.. ..+..-+.+ +-+|+||+...
T Consensus 318 W~~~~~--~~~~~~sp~--v~~g~l~v~~~ 343 (394)
T PRK11138 318 WSQSDL--LHRLLTAPV--LYNGYLVVGDS 343 (394)
T ss_pred Eccccc--CCCcccCCE--EECCEEEEEeC
Confidence 864211 122222222 34999988644
No 45
>PF07646 Kelch_2: Kelch motif; InterPro: IPR011498 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding
Probab=97.12 E-value=0.00063 Score=49.42 Aligned_cols=41 Identities=20% Similarity=0.334 Sum_probs=32.7
Q ss_pred cccceEcCCCcEEEEcCC--CC---CccEEEEEcCCCCCCcccccCCCC
Q 043369 108 CSSGALLANGVLVQTGGY--RL---GERVVRYLKPCSDCDWEEDHQNGL 151 (526)
Q Consensus 108 c~~~~~l~~G~l~v~GG~--~~---g~~~v~~ydp~~t~~W~~~~~~~m 151 (526)
+..++++++++||++||. .. -.+.+++||+. +.+|+++ ..|
T Consensus 3 ~~hs~~~~~~kiyv~GG~~~~~~~~~~~~v~~~d~~-t~~W~~~--~~~ 48 (49)
T PF07646_consen 3 YGHSAVVLDGKIYVFGGYGTDNGGSSSNDVWVFDTE-TNQWTEL--SPM 48 (49)
T ss_pred cceEEEEECCEEEEECCcccCCCCcccceeEEEECC-CCEEeec--CCC
Confidence 445677889999999999 21 14789999999 9999998 455
No 46
>PRK13684 Ycf48-like protein; Provisional
Probab=97.06 E-value=0.49 Score=48.96 Aligned_cols=74 Identities=14% Similarity=0.130 Sum_probs=41.2
Q ss_pred CCCceecccCcc---ccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCC-CCccccccccce
Q 043369 325 NPKWEMEEMPLN---RVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSP-SLIPRLYHSTAH 400 (526)
Q Consensus 325 ~~~W~~~~M~~~---R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~-~~~~R~yhs~a~ 400 (526)
...|+...++.. ....+....++++++++|... . +..-...-.+|+.+.. ...+..+.. .+
T Consensus 245 G~sW~~~~~~~~~~~~~l~~v~~~~~~~~~~~G~~G--~------------v~~S~d~G~tW~~~~~~~~~~~~~~~-~~ 309 (334)
T PRK13684 245 LESWSKPIIPEITNGYGYLDLAYRTPGEIWAGGGNG--T------------LLVSKDGGKTWEKDPVGEEVPSNFYK-IV 309 (334)
T ss_pred CCccccccCCccccccceeeEEEcCCCCEEEEcCCC--e------------EEEeCCCCCCCeECCcCCCCCcceEE-EE
Confidence 468986544422 122334456788999987642 1 1111222348988753 333434444 34
Q ss_pred ecCCCEEEEecCC
Q 043369 401 LLSDGRVLVGGSN 413 (526)
Q Consensus 401 LlpdG~V~v~GG~ 413 (526)
...+++.|++|..
T Consensus 310 ~~~~~~~~~~G~~ 322 (334)
T PRK13684 310 FLDPEKGFVLGQR 322 (334)
T ss_pred EeCCCceEEECCC
Confidence 4568888888874
No 47
>PF13418 Kelch_4: Galactose oxidase, central domain; PDB: 2UVK_B.
Probab=96.93 E-value=0.0011 Score=48.03 Aligned_cols=39 Identities=28% Similarity=0.348 Sum_probs=24.5
Q ss_pred ccccceeEEecCCcEEEEcCccCC-----eEEEE-cCCCCCCCcceeecC
Q 043369 154 PRWYASNQILPNGKIIVVGGRFQF-----TYEFI-PRTSDSDRKILYQLP 197 (526)
Q Consensus 154 ~R~y~s~~~L~dG~v~viGG~~~~-----~~E~y-P~~~~~~~~~w~~~p 197 (526)
+|++|+++.+.+++|||+||.+.. .+++| +.++ +|..++
T Consensus 1 pR~~h~~~~~~~~~i~v~GG~~~~~~~~~d~~~~d~~~~-----~W~~~~ 45 (49)
T PF13418_consen 1 PRYGHSAVSIGDNSIYVFGGRDSSGSPLNDLWIFDIETN-----TWTRLP 45 (49)
T ss_dssp --BS-EEEEE-TTEEEEE--EEE-TEE---EEEEETTTT-----EEEE--
T ss_pred CcceEEEEEEeCCeEEEECCCCCCCcccCCEEEEECCCC-----EEEECC
Confidence 699999999978999999998752 46788 7776 787664
No 48
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=96.84 E-value=0.38 Score=47.53 Aligned_cols=226 Identities=18% Similarity=0.151 Sum_probs=122.1
Q ss_pred EEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccc---eeEEe
Q 043369 87 AVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYA---SNQIL 163 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~---s~~~L 163 (526)
....||.|++....+...-..=.+.+.-+||...|+=+ ...+..+||+ +...++. +|+..+-+. +.+-=
T Consensus 85 iGhLdP~tGev~~ypLg~Ga~Phgiv~gpdg~~Witd~----~~aI~R~dpk-t~evt~f---~lp~~~a~~nlet~vfD 156 (353)
T COG4257 85 IGHLDPATGEVETYPLGSGASPHGIVVGPDGSAWITDT----GLAIGRLDPK-TLEVTRF---PLPLEHADANLETAVFD 156 (353)
T ss_pred ceecCCCCCceEEEecCCCCCCceEEECCCCCeeEecC----cceeEEecCc-ccceEEe---ecccccCCCcccceeeC
Confidence 34589999999887765433333455566877777632 3479999998 6665554 233334332 23333
Q ss_pred cCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEE--EccceEEEeccCCe
Q 043369 164 PNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIF--ANDRAILLDYVNNR 241 (526)
Q Consensus 164 ~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~--Gg~~~~~yDp~t~~ 241 (526)
++|.+...|-..- -.+.-|.++ .-...|..+.- .-| -+++.+||.+|+. .|+..-+.||.+..
T Consensus 157 ~~G~lWFt~q~G~-yGrLdPa~~-----~i~vfpaPqG~--------gpy-Gi~atpdGsvwyaslagnaiaridp~~~~ 221 (353)
T COG4257 157 PWGNLWFTGQIGA-YGRLDPARN-----VISVFPAPQGG--------GPY-GICATPDGSVWYASLAGNAIARIDPFAGH 221 (353)
T ss_pred CCccEEEeecccc-ceecCcccC-----ceeeeccCCCC--------CCc-ceEECCCCcEEEEeccccceEEcccccCC
Confidence 4588887764221 111113332 11111111110 112 2467889999987 56666778888764
Q ss_pred EEEeccCCCCC---CCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEE
Q 043369 242 VMKNYPVMPGG---ISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGR 318 (526)
Q Consensus 242 w~~~~p~~p~~---~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~ 318 (526)
-+ .+| .|.. ..|.. .+. -.+++.+. . -...++.+
T Consensus 222 ae-v~p-~P~~~~~gsRri---wsd---------------------pig~~wit---t--------------wg~g~l~r 258 (353)
T COG4257 222 AE-VVP-QPNALKAGSRRI---WSD---------------------PIGRAWIT---T--------------WGTGSLHR 258 (353)
T ss_pred cc-eec-CCCccccccccc---ccC---------------------ccCcEEEe---c--------------cCCceeeE
Confidence 33 232 2322 01211 110 14566554 1 01235678
Q ss_pred EEeecCCCCceecccC--ccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCcccccc
Q 043369 319 LTITAQNPKWEMEEMP--LNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYH 396 (526)
Q Consensus 319 ~d~~~~~~~W~~~~M~--~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yh 396 (526)
|||. ...|.+-+|| .+|-+.-- |=-.|+|+..-= . ......|||++.+|+.+. ++|-..
T Consensus 259 fdPs--~~sW~eypLPgs~arpys~r-VD~~grVW~sea-~------------agai~rfdpeta~ftv~p---~pr~n~ 319 (353)
T COG4257 259 FDPS--VTSWIEYPLPGSKARPYSMR-VDRHGRVWLSEA-D------------AGAIGRFDPETARFTVLP---IPRPNS 319 (353)
T ss_pred eCcc--cccceeeeCCCCCCCcceee-eccCCcEEeecc-c------------cCceeecCcccceEEEec---CCCCCC
Confidence 9986 3669875554 56655332 323577776311 0 114689999999998863 455533
Q ss_pred c
Q 043369 397 S 397 (526)
Q Consensus 397 s 397 (526)
.
T Consensus 320 g 320 (353)
T COG4257 320 G 320 (353)
T ss_pred C
Confidence 3
No 49
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=96.81 E-value=0.85 Score=48.11 Aligned_cols=242 Identities=11% Similarity=0.142 Sum_probs=119.2
Q ss_pred ceEEEEeCCCCc--EEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCC--cccccce
Q 043369 85 AHAVEFDPITRK--VRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLI--SPRWYAS 159 (526)
Q Consensus 85 ~~~~~yDp~t~~--w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~--~~R~y~s 159 (526)
.....+|.+|++ |+.-. .....+ ..++.++++|+..+. ..+..||+.+ ...|... ...+ ..|...+
T Consensus 130 g~l~ald~~tG~~~W~~~~-~~~~~s--sP~v~~~~v~v~~~~----g~l~ald~~tG~~~W~~~--~~~~~~~~~~~~s 200 (394)
T PRK11138 130 GQVYALNAEDGEVAWQTKV-AGEALS--RPVVSDGLVLVHTSN----GMLQALNESDGAVKWTVN--LDVPSLTLRGESA 200 (394)
T ss_pred CEEEEEECCCCCCcccccC-CCceec--CCEEECCEEEEECCC----CEEEEEEccCCCEeeeec--CCCCcccccCCCC
Confidence 356789998876 65432 112222 234557888875442 3688899972 2358654 2211 1122333
Q ss_pred eEEecCCcEEEEcCccCCeEEEE-cCCCCCCCcceee-cCCccccCCCC-CCCCCCcceEEEecCCcEEEEEc-cceEEE
Q 043369 160 NQILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQ-LPFLKETMHSP-KIPNNLYPFLHLSTDGNLFIFAN-DRAILL 235 (526)
Q Consensus 160 ~~~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~-~p~l~~~~~~~-~~~~~~yp~~~~~~dG~Iy~~Gg-~~~~~y 235 (526)
.++ .+|.+|+..+ ++. +-.+ +.++. ..|.. ........... ......-| ++.+|.||+.+. .....+
T Consensus 201 P~v-~~~~v~~~~~-~g~-v~a~d~~~G~---~~W~~~~~~~~~~~~~~~~~~~~~sP---~v~~~~vy~~~~~g~l~al 271 (394)
T PRK11138 201 PAT-AFGGAIVGGD-NGR-VSAVLMEQGQ---LIWQQRISQPTGATEIDRLVDVDTTP---VVVGGVVYALAYNGNLVAL 271 (394)
T ss_pred CEE-ECCEEEEEcC-CCE-EEEEEccCCh---hhheeccccCCCccchhcccccCCCc---EEECCEEEEEEcCCeEEEE
Confidence 333 3677777544 222 2223 55442 24532 11000000000 00001112 345889988663 246778
Q ss_pred eccCCe--EEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccc
Q 043369 236 DYVNNR--VMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAA 313 (526)
Q Consensus 236 Dp~t~~--w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~ 313 (526)
|+++++ |.+.+ .. . ....+ .+++||+.....
T Consensus 272 d~~tG~~~W~~~~---~~-----~--~~~~~--------------------~~~~vy~~~~~g----------------- 304 (394)
T PRK11138 272 DLRSGQIVWKREY---GS-----V--NDFAV--------------------DGGRIYLVDQND----------------- 304 (394)
T ss_pred ECCCCCEEEeecC---CC-----c--cCcEE--------------------ECCEEEEEcCCC-----------------
Confidence 998875 54211 10 0 01111 378888875321
Q ss_pred cceEEEEeecCCCCceecccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCc--EeecCCCCc
Q 043369 314 KSCGRLTITAQNPKWEMEEMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINR--FRILSPSLI 391 (526)
Q Consensus 314 ~s~~~~d~~~~~~~W~~~~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~--Wt~~a~~~~ 391 (526)
.+.++|+.+....|+...+. .+.....++ .+|+||+.... | .+.+.|+++.+ |+.-- ..
T Consensus 305 -~l~ald~~tG~~~W~~~~~~-~~~~~sp~v-~~g~l~v~~~~--G------------~l~~ld~~tG~~~~~~~~--~~ 365 (394)
T PRK11138 305 -RVYALDTRGGVELWSQSDLL-HRLLTAPVL-YNGYLVVGDSE--G------------YLHWINREDGRFVAQQKV--DS 365 (394)
T ss_pred -eEEEEECCCCcEEEcccccC-CCcccCCEE-ECCEEEEEeCC--C------------EEEEEECCCCCEEEEEEc--CC
Confidence 35578876545568754322 233333343 49999875331 1 35678988883 65311 11
Q ss_pred cccccccceecCCCEEEEecC
Q 043369 392 PRLYHSTAHLLSDGRVLVGGS 412 (526)
Q Consensus 392 ~R~yhs~a~LlpdG~V~v~GG 412 (526)
...+.+-++ .||+|||..-
T Consensus 366 ~~~~s~P~~--~~~~l~v~t~ 384 (394)
T PRK11138 366 SGFLSEPVV--ADDKLLIQAR 384 (394)
T ss_pred CcceeCCEE--ECCEEEEEeC
Confidence 123333333 4899988743
No 50
>PLN02772 guanylate kinase
Probab=96.30 E-value=0.012 Score=61.37 Aligned_cols=69 Identities=16% Similarity=0.102 Sum_probs=54.3
Q ss_pred cccccceEcCCCcEEEEcCCCCC---ccEEEEEcCCCCCCcccccC-CCCCcccccceeEEecCCcEEEEcCcc
Q 043369 106 TWCSSGALLANGVLVQTGGYRLG---ERVVRYLKPCSDCDWEEDHQ-NGLISPRWYASNQILPNGKIIVVGGRF 175 (526)
Q Consensus 106 ~fc~~~~~l~~G~l~v~GG~~~g---~~~v~~ydp~~t~~W~~~~~-~~m~~~R~y~s~~~L~dG~v~viGG~~ 175 (526)
..|...++..+.++|++||..+. ...+.+||+. +.+|..... ..-+.+|-.|+++++.|++|+|+++-.
T Consensus 24 ~~~~~tav~igdk~yv~GG~~d~~~~~~~v~i~D~~-t~~W~~P~V~G~~P~~r~GhSa~v~~~~rilv~~~~~ 96 (398)
T PLN02772 24 PKNRETSVTIGDKTYVIGGNHEGNTLSIGVQILDKI-TNNWVSPIVLGTGPKPCKGYSAVVLNKDRILVIKKGS 96 (398)
T ss_pred CCCcceeEEECCEEEEEcccCCCccccceEEEEECC-CCcEecccccCCCCCCCCcceEEEECCceEEEEeCCC
Confidence 33445666778999999997653 3589999999 999987410 256788999999999999999998754
No 51
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=95.37 E-value=3.1 Score=40.84 Aligned_cols=133 Identities=17% Similarity=0.186 Sum_probs=64.9
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcE-EEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEec
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVL-VQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILP 164 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l-~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~ 164 (526)
...+||+.+++....-..... ..+....+||+. |++++. ...+.+||.. +.+.... -..-..++ ..+..+
T Consensus 12 ~v~~~d~~t~~~~~~~~~~~~-~~~l~~~~dg~~l~~~~~~---~~~v~~~d~~-~~~~~~~-~~~~~~~~---~~~~~~ 82 (300)
T TIGR03866 12 TISVIDTATLEVTRTFPVGQR-PRGITLSKDGKLLYVCASD---SDTIQVIDLA-TGEVIGT-LPSGPDPE---LFALHP 82 (300)
T ss_pred EEEEEECCCCceEEEEECCCC-CCceEECCCCCEEEEEECC---CCeEEEEECC-CCcEEEe-ccCCCCcc---EEEECC
Confidence 355677776654332211111 223455678875 466553 2578899987 6554332 01111122 344556
Q ss_pred CCcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcce-EEEecCCcEEEEEccc---eEEEeccC
Q 043369 165 NGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPF-LHLSTDGNLFIFANDR---AILLDYVN 239 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~-~~~~~dG~Iy~~Gg~~---~~~yDp~t 239 (526)
||+.+.+.+.....+.+| ..+.. ....++. . ..+. ....+||++++++..+ ...||..+
T Consensus 83 ~g~~l~~~~~~~~~l~~~d~~~~~----~~~~~~~--~----------~~~~~~~~~~dg~~l~~~~~~~~~~~~~d~~~ 146 (300)
T TIGR03866 83 NGKILYIANEDDNLVTVIDIETRK----VLAEIPV--G----------VEPEGMAVSPDGKIVVNTSETTNMAHFIDTKT 146 (300)
T ss_pred CCCEEEEEcCCCCeEEEEECCCCe----EEeEeeC--C----------CCcceEEECCCCCEEEEEecCCCeEEEEeCCC
Confidence 777544443333356666 44320 1111110 0 0111 3446799998887643 34568776
Q ss_pred CeEE
Q 043369 240 NRVM 243 (526)
Q Consensus 240 ~~w~ 243 (526)
.+..
T Consensus 147 ~~~~ 150 (300)
T TIGR03866 147 YEIV 150 (300)
T ss_pred CeEE
Confidence 6543
No 52
>PF13854 Kelch_5: Kelch motif
Probab=95.36 E-value=0.034 Score=38.86 Aligned_cols=41 Identities=10% Similarity=0.118 Sum_probs=29.2
Q ss_pred cCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCC
Q 043369 333 MPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKI 380 (526)
Q Consensus 333 M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t 380 (526)
+|.+|..|++++. +++|||+||... . .......+.+||..+
T Consensus 1 ~P~~R~~hs~~~~-~~~iyi~GG~~~-~-----~~~~~~d~~~l~l~s 41 (42)
T PF13854_consen 1 IPSPRYGHSAVVV-GNNIYIFGGYSG-N-----NNSYSNDLYVLDLPS 41 (42)
T ss_pred CCCCccceEEEEE-CCEEEEEcCccC-C-----CCCEECcEEEEECCC
Confidence 4789999998876 999999999872 1 122334567777654
No 53
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=94.85 E-value=3.6 Score=38.93 Aligned_cols=132 Identities=17% Similarity=0.151 Sum_probs=63.7
Q ss_pred EEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCccc-ccceeEEecC
Q 043369 87 AVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPR-WYASNQILPN 165 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R-~y~s~~~L~d 165 (526)
..+||..+++.......+..........++++.+++++.. ..+.+||.. +.+.... +.... .-.+....++
T Consensus 33 i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~---~~i~i~~~~-~~~~~~~----~~~~~~~i~~~~~~~~ 104 (289)
T cd00200 33 IKVWDLETGELLRTLKGHTGPVRDVAASADGTYLASGSSD---KTIRLWDLE-TGECVRT----LTGHTSYVSSVAFSPD 104 (289)
T ss_pred EEEEEeeCCCcEEEEecCCcceeEEEECCCCCEEEEEcCC---CeEEEEEcC-cccceEE----EeccCCcEEEEEEcCC
Confidence 5567776654222111222222234456678788888763 578889887 5322211 11111 1123344456
Q ss_pred CcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEc--cceEEEeccCCe
Q 043369 166 GKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAN--DRAILLDYVNNR 241 (526)
Q Consensus 166 G~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg--~~~~~yDp~t~~ 241 (526)
+++++.|+.++ .+.+| ..+.. ....+.... .... .....+++++++.+. ....+||..+++
T Consensus 105 ~~~~~~~~~~~-~i~~~~~~~~~----~~~~~~~~~---------~~i~-~~~~~~~~~~l~~~~~~~~i~i~d~~~~~ 168 (289)
T cd00200 105 GRILSSSSRDK-TIKVWDVETGK----CLTTLRGHT---------DWVN-SVAFSPDGTFVASSSQDGTIKLWDLRTGK 168 (289)
T ss_pred CCEEEEecCCC-eEEEEECCCcE----EEEEeccCC---------CcEE-EEEEcCcCCEEEEEcCCCcEEEEEccccc
Confidence 67777777443 45566 44220 111111000 0011 123344677777664 346788887654
No 54
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=94.53 E-value=3.5 Score=43.63 Aligned_cols=245 Identities=15% Similarity=0.158 Sum_probs=123.2
Q ss_pred cceEEEEeCCCCcEEe-CccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCccc-c--cCCCCCcccccce
Q 043369 84 YAHAVEFDPITRKVRP-LTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEE-D--HQNGLISPRWYAS 159 (526)
Q Consensus 84 ~~~~~~yDp~t~~w~~-~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~-~--~~~~m~~~R~y~s 159 (526)
.+.+.+|+..+..... +....+.-|+ ..+=.||+++.+|+.. -.|.+||-. +..-.. . +.++-..-++
T Consensus 47 S~rvqly~~~~~~~~k~~srFk~~v~s-~~fR~DG~LlaaGD~s---G~V~vfD~k-~r~iLR~~~ah~apv~~~~f--- 118 (487)
T KOG0310|consen 47 SVRVQLYSSVTRSVRKTFSRFKDVVYS-VDFRSDGRLLAAGDES---GHVKVFDMK-SRVILRQLYAHQAPVHVTKF--- 118 (487)
T ss_pred ccEEEEEecchhhhhhhHHhhccceeE-EEeecCCeEEEccCCc---CcEEEeccc-cHHHHHHHhhccCceeEEEe---
Confidence 4567888887765544 3334444444 3445699999999863 368899954 311100 0 0111111111
Q ss_pred eEEecCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceE--EEecCCcEEEEEccc--eEEE
Q 043369 160 NQILPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFL--HLSTDGNLFIFANDR--AILL 235 (526)
Q Consensus 160 ~~~L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~--~~~~dG~Iy~~Gg~~--~~~y 235 (526)
+ -.|+.+++.|+-+. ...+|...+ ...... +....| |=++ +.-.++.|++.||.+ .-+|
T Consensus 119 -~-~~d~t~l~s~sDd~-v~k~~d~s~-----a~v~~~-l~~htD--------YVR~g~~~~~~~hivvtGsYDg~vrl~ 181 (487)
T KOG0310|consen 119 -S-PQDNTMLVSGSDDK-VVKYWDLST-----AYVQAE-LSGHTD--------YVRCGDISPANDHIVVTGSYDGKVRLW 181 (487)
T ss_pred -c-ccCCeEEEecCCCc-eEEEEEcCC-----cEEEEE-ecCCcc--------eeEeeccccCCCeEEEecCCCceEEEE
Confidence 1 13788888887543 333442221 111111 111111 2222 222367899999976 5678
Q ss_pred eccCC-eEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhccccccc
Q 043369 236 DYVNN-RVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAK 314 (526)
Q Consensus 236 Dp~t~-~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~ 314 (526)
|.++. .|... +..+. ..-.+++|. -...|-.+||.
T Consensus 182 DtR~~~~~v~e---lnhg~-------pVe~vl~lp---------------sgs~iasAgGn------------------- 217 (487)
T KOG0310|consen 182 DTRSLTSRVVE---LNHGC-------PVESVLALP---------------SGSLIASAGGN------------------- 217 (487)
T ss_pred EeccCCceeEE---ecCCC-------ceeeEEEcC---------------CCCEEEEcCCC-------------------
Confidence 98876 55432 23221 112233332 14566666663
Q ss_pred ceEEEEeecCCCCceecccC-ccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccc
Q 043369 315 SCGRLTITAQNPKWEMEEMP-LNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPR 393 (526)
Q Consensus 315 s~~~~d~~~~~~~W~~~~M~-~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R 393 (526)
++-++|+.. ..+ ....|. +--.--+....-|+.=++.||-+. .+-+|| +..|+.+-.+..|-
T Consensus 218 ~vkVWDl~~-G~q-ll~~~~~H~KtVTcL~l~s~~~rLlS~sLD~-------------~VKVfd--~t~~Kvv~s~~~~~ 280 (487)
T KOG0310|consen 218 SVKVWDLTT-GGQ-LLTSMFNHNKTVTCLRLASDSTRLLSGSLDR-------------HVKVFD--TTNYKVVHSWKYPG 280 (487)
T ss_pred eEEEEEecC-Cce-ehhhhhcccceEEEEEeecCCceEeeccccc-------------ceEEEE--ccceEEEEeeeccc
Confidence 245677652 111 111222 111111112223556666676551 478999 56676665554444
Q ss_pred cccccceecCCCEEEEecCCCC
Q 043369 394 LYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 394 ~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
---|.++ -||++.+|+|....
T Consensus 281 pvLsiav-s~dd~t~viGmsnG 301 (487)
T KOG0310|consen 281 PVLSIAV-SPDDQTVVIGMSNG 301 (487)
T ss_pred ceeeEEe-cCCCceEEEecccc
Confidence 3345554 47999999998643
No 55
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=94.11 E-value=6.3 Score=38.56 Aligned_cols=133 Identities=19% Similarity=0.194 Sum_probs=67.1
Q ss_pred eEEEEeCCCCcEEe-CccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEec
Q 043369 86 HAVEFDPITRKVRP-LTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILP 164 (526)
Q Consensus 86 ~~~~yDp~t~~w~~-~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~ 164 (526)
...+||..+++... +...... ......++|+.+.+.+..+ ..+.+||.. +.+-.. .+.....-.+.+.-+
T Consensus 54 ~v~~~d~~~~~~~~~~~~~~~~--~~~~~~~~g~~l~~~~~~~--~~l~~~d~~-~~~~~~----~~~~~~~~~~~~~~~ 124 (300)
T TIGR03866 54 TIQVIDLATGEVIGTLPSGPDP--ELFALHPNGKILYIANEDD--NLVTVIDIE-TRKVLA----EIPVGVEPEGMAVSP 124 (300)
T ss_pred eEEEEECCCCcEEEeccCCCCc--cEEEECCCCCEEEEEcCCC--CeEEEEECC-CCeEEe----EeeCCCCcceEEECC
Confidence 35678988877654 3222222 2234556777554443222 478899987 543211 122111112345557
Q ss_pred CCcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcc-eEEEecCCcEEEEEc---cceEEEeccC
Q 043369 165 NGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYP-FLHLSTDGNLFIFAN---DRAILLDYVN 239 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp-~~~~~~dG~Iy~~Gg---~~~~~yDp~t 239 (526)
||+.++++..+......| ..+.. .....+. .. .| .....+||+.+++++ ....+||..+
T Consensus 125 dg~~l~~~~~~~~~~~~~d~~~~~----~~~~~~~--~~----------~~~~~~~s~dg~~l~~~~~~~~~v~i~d~~~ 188 (300)
T TIGR03866 125 DGKIVVNTSETTNMAHFIDTKTYE----IVDNVLV--DQ----------RPRFAEFTADGKELWVSSEIGGTVSVIDVAT 188 (300)
T ss_pred CCCEEEEEecCCCeEEEEeCCCCe----EEEEEEc--CC----------CccEEEECCCCCEEEEEcCCCCEEEEEEcCc
Confidence 899988887654334444 33220 1111110 00 11 123456887665543 3467899988
Q ss_pred CeEE
Q 043369 240 NRVM 243 (526)
Q Consensus 240 ~~w~ 243 (526)
.+..
T Consensus 189 ~~~~ 192 (300)
T TIGR03866 189 RKVI 192 (300)
T ss_pred ceee
Confidence 7654
No 56
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=94.07 E-value=2.1 Score=43.58 Aligned_cols=163 Identities=17% Similarity=0.252 Sum_probs=80.0
Q ss_pred CCCcEEEcccCCccceeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCc
Q 043369 26 LEGKWKLLKRSIGVSAMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTD 105 (526)
Q Consensus 26 ~~g~W~~~~~~~~v~~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~ 105 (526)
....|+.+.....-+......+++|++++++.. |+ ....+||....|.+......
T Consensus 132 gG~tW~~~~~~~~gs~~~~~r~~dG~~vavs~~-----------G~--------------~~~s~~~G~~~w~~~~r~~~ 186 (302)
T PF14870_consen 132 GGKTWQAVVSETSGSINDITRSSDGRYVAVSSR-----------GN--------------FYSSWDPGQTTWQPHNRNSS 186 (302)
T ss_dssp TTSSEEEEE-S----EEEEEE-TTS-EEEEETT-----------SS--------------EEEEE-TT-SS-EEEE--SS
T ss_pred CCCCeeEcccCCcceeEeEEECCCCcEEEEECc-----------cc--------------EEEEecCCCccceEEccCcc
Confidence 346899876433222223344689998888754 21 34568998889999877655
Q ss_pred cccccceEcCCCcEEEEcCCCCCccEEEEEc-CCCCCCcccccCCCCCcccc-cceeEEecCCcEEEEcCccCCeEEEE-
Q 043369 106 TWCSSGALLANGVLVQTGGYRLGERVVRYLK-PCSDCDWEEDHQNGLISPRW-YASNQILPNGKIIVVGGRFQFTYEFI- 182 (526)
Q Consensus 106 ~fc~~~~~l~~G~l~v~GG~~~g~~~v~~yd-p~~t~~W~~~~~~~m~~~R~-y~s~~~L~dG~v~viGG~~~~~~E~y- 182 (526)
.+-....+.+|+.++++. . .| .+..=+ +.+.++|.+. ..+.....+ +..++.-.+++++++||... +|
T Consensus 187 ~riq~~gf~~~~~lw~~~-~-Gg--~~~~s~~~~~~~~w~~~-~~~~~~~~~~~ld~a~~~~~~~wa~gg~G~----l~~ 257 (302)
T PF14870_consen 187 RRIQSMGFSPDGNLWMLA-R-GG--QIQFSDDPDDGETWSEP-IIPIKTNGYGILDLAYRPPNEIWAVGGSGT----LLV 257 (302)
T ss_dssp S-EEEEEE-TTS-EEEEE-T-TT--EEEEEE-TTEEEEE----B-TTSS--S-EEEEEESSSS-EEEEESTT-----EEE
T ss_pred ceehhceecCCCCEEEEe-C-Cc--EEEEccCCCCccccccc-cCCcccCceeeEEEEecCCCCEEEEeCCcc----EEE
Confidence 555556677888887764 1 11 222222 3325678874 123433444 46677777899999999753 33
Q ss_pred cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccce
Q 043369 183 PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRA 232 (526)
Q Consensus 183 P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~ 232 (526)
...+- .+|...+.... .+.|+|-..+. .+.+-|++|.+..
T Consensus 258 S~DgG---ktW~~~~~~~~------~~~n~~~i~f~-~~~~gf~lG~~G~ 297 (302)
T PF14870_consen 258 STDGG---KTWQKDRVGEN------VPSNLYRIVFV-NPDKGFVLGQDGV 297 (302)
T ss_dssp ESSTT---SS-EE-GGGTT------SSS---EEEEE-ETTEEEEE-STTE
T ss_pred eCCCC---ccceECccccC------CCCceEEEEEc-CCCceEEECCCcE
Confidence 22221 37876543222 24578865544 4679999987653
No 57
>TIGR01640 F_box_assoc_1 F-box protein interaction domain. This model describes a large family of plant domains, with several hundred members in Arabidopsis thaliana. Most examples are found C-terminal to an F-box (pfam00646), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes. Some members have two copies of this domain.
Probab=94.02 E-value=4.4 Score=39.15 Aligned_cols=143 Identities=12% Similarity=0.103 Sum_probs=83.5
Q ss_pred ceEEEEeCCCCcEEeCccCCc--cccccceEcCCCcEEEEcCCCCC-c-cEEEEEcCCCCCCccc-ccCCCCCcc----c
Q 043369 85 AHAVEFDPITRKVRPLTIQTD--TWCSSGALLANGVLVQTGGYRLG-E-RVVRYLKPCSDCDWEE-DHQNGLISP----R 155 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~~~~~~--~fc~~~~~l~~G~l~v~GG~~~g-~-~~v~~ydp~~t~~W~~-~~~~~m~~~----R 155 (526)
...++|+..+++|+.+..... .... ..++.||.++-+.-...+ . ..+-.||.. +++|.+ . +++.. .
T Consensus 70 ~~~~Vys~~~~~Wr~~~~~~~~~~~~~-~~v~~~G~lyw~~~~~~~~~~~~IvsFDl~-~E~f~~~i---~~P~~~~~~~ 144 (230)
T TIGR01640 70 SEHQVYTLGSNSWRTIECSPPHHPLKS-RGVCINGVLYYLAYTLKTNPDYFIVSFDVS-SERFKEFI---PLPCGNSDSV 144 (230)
T ss_pred ccEEEEEeCCCCccccccCCCCccccC-CeEEECCEEEEEEEECCCCCcEEEEEEEcc-cceEeeee---ecCccccccc
Confidence 357899999999999874321 1222 256778988887643221 1 268889999 999985 5 23322 2
Q ss_pred ccceeEEecCCcEEEEcCccC-CeEEEE-cCCCCCCCcceee---cCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc
Q 043369 156 WYASNQILPNGKIIVVGGRFQ-FTYEFI-PRTSDSDRKILYQ---LPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND 230 (526)
Q Consensus 156 ~y~s~~~L~dG~v~viGG~~~-~~~E~y-P~~~~~~~~~w~~---~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~ 230 (526)
.+...+.+ +|++-++.-... ...|+| -+... ...|.. +++.... + .....+| .....+|+|++....
T Consensus 145 ~~~~L~~~-~G~L~~v~~~~~~~~~~IWvl~d~~--~~~W~k~~~i~~~~~~-~---~~~~~~~-~~~~~~g~I~~~~~~ 216 (230)
T TIGR01640 145 DYLSLINY-KGKLAVLKQKKDTNNFDLWVLNDAG--KQEWSKLFTVPIPPLP-D---LVDDNFL-SGFTDKGEIVLCCED 216 (230)
T ss_pred cceEEEEE-CCEEEEEEecCCCCcEEEEEECCCC--CCceeEEEEEcCcchh-h---hhhheeE-eEEeeCCEEEEEeCC
Confidence 24566777 699888776432 357888 33110 124753 3321000 0 0011222 345668999987653
Q ss_pred ---c-eEEEeccCC
Q 043369 231 ---R-AILLDYVNN 240 (526)
Q Consensus 231 ---~-~~~yDp~t~ 240 (526)
. ..+||+++|
T Consensus 217 ~~~~~~~~y~~~~~ 230 (230)
T TIGR01640 217 ENPFYIFYYNVGEN 230 (230)
T ss_pred CCceEEEEEeccCC
Confidence 2 667888764
No 58
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=93.99 E-value=8.7 Score=39.72 Aligned_cols=150 Identities=15% Similarity=0.102 Sum_probs=68.6
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEc-CC-CcEEEEcCCCCCccEEEEEc--CCCCCCcccccCCCCC-ccccccee
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALL-AN-GVLVQTGGYRLGERVVRYLK--PCSDCDWEEDHQNGLI-SPRWYASN 160 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l-~~-G~l~v~GG~~~g~~~v~~yd--p~~t~~W~~~~~~~m~-~~R~y~s~ 160 (526)
....||.++++++.+......-.+.-.++ ++ ..||++.........+..|+ +. +.+.+.+ .... .+..-...
T Consensus 16 ~~~~~d~~~g~l~~~~~~~~~~~Ps~l~~~~~~~~LY~~~e~~~~~g~v~~~~i~~~-~g~L~~~--~~~~~~g~~p~~i 92 (345)
T PF10282_consen 16 YVFRFDEETGTLTLVQTVAEGENPSWLAVSPDGRRLYVVNEGSGDSGGVSSYRIDPD-TGTLTLL--NSVPSGGSSPCHI 92 (345)
T ss_dssp EEEEEETTTTEEEEEEEEEESSSECCEEE-TTSSEEEEEETTSSTTTEEEEEEEETT-TTEEEEE--EEEEESSSCEEEE
T ss_pred EEEEEcCCCCCceEeeeecCCCCCceEEEEeCCCEEEEEEccccCCCCEEEEEECCC-cceeEEe--eeeccCCCCcEEE
Confidence 45668999999987664211111122233 44 56666654311123444444 43 3455554 2333 33432234
Q ss_pred EEecCCcEEEEcCccCCeEEEEcCCCCCCCcceeec-CCcc--ccCCCCCCCCCCcceEE-EecCCcEEEEE---ccceE
Q 043369 161 QILPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQL-PFLK--ETMHSPKIPNNLYPFLH-LSTDGNLFIFA---NDRAI 233 (526)
Q Consensus 161 ~~L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~-p~l~--~~~~~~~~~~~~yp~~~-~~~dG~Iy~~G---g~~~~ 233 (526)
+.-+||+.+++.-....++.+|+.... ..-... .... ............+||.. ..+||+.+++. .....
T Consensus 93 ~~~~~g~~l~vany~~g~v~v~~l~~~---g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v~v~dlG~D~v~ 169 (345)
T PF10282_consen 93 AVDPDGRFLYVANYGGGSVSVFPLDDD---GSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFVYVPDLGADRVY 169 (345)
T ss_dssp EECTTSSEEEEEETTTTEEEEEEECTT---SEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEEEEEETTTTEEE
T ss_pred EEecCCCEEEEEEccCCeEEEEEccCC---cccceeeeecccCCCCCcccccccccceeEEECCCCCEEEEEecCCCEEE
Confidence 444577776665444556777733220 011111 0000 00000000123356643 45688755553 35577
Q ss_pred EEeccCCe
Q 043369 234 LLDYVNNR 241 (526)
Q Consensus 234 ~yDp~t~~ 241 (526)
+|+...+.
T Consensus 170 ~~~~~~~~ 177 (345)
T PF10282_consen 170 VYDIDDDT 177 (345)
T ss_dssp EEEE-TTS
T ss_pred EEEEeCCC
Confidence 88887654
No 59
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=93.69 E-value=10 Score=39.48 Aligned_cols=246 Identities=15% Similarity=0.171 Sum_probs=113.8
Q ss_pred ceEEEEeCCCCc--EEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCCcccccceeE
Q 043369 85 AHAVEFDPITRK--VRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLISPRWYASNQ 161 (526)
Q Consensus 85 ~~~~~yDp~t~~--w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~~~R~y~s~~ 161 (526)
.....+|+++++ |+.... ....+ ...+.++++++..+. ..+..+|+.+ ...|......+-...+...+.+
T Consensus 115 g~l~ald~~tG~~~W~~~~~-~~~~~--~p~v~~~~v~v~~~~----g~l~a~d~~tG~~~W~~~~~~~~~~~~~~~sp~ 187 (377)
T TIGR03300 115 GEVIALDAEDGKELWRAKLS-SEVLS--PPLVANGLVVVRTND----GRLTALDAATGERLWTYSRVTPALTLRGSASPV 187 (377)
T ss_pred CEEEEEECCCCcEeeeeccC-ceeec--CCEEECCEEEEECCC----CeEEEEEcCCCceeeEEccCCCceeecCCCCCE
Confidence 356788988876 653311 11222 233456777765432 3588889872 2357643111100113333444
Q ss_pred EecCCcEEEEcCccCCeEEEE-cCCCCCCCcceee-cCCccccCCCCCCCCCCcceEEEecCCcEEEEEc-cceEEEecc
Q 043369 162 ILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQ-LPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAN-DRAILLDYV 238 (526)
Q Consensus 162 ~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~-~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg-~~~~~yDp~ 238 (526)
.. ++.+| +|..++ .+-.+ +.++. ..|.. ........+.. ...... ..-++.++.||+... ....+||++
T Consensus 188 ~~-~~~v~-~~~~~g-~v~ald~~tG~---~~W~~~~~~~~g~~~~~-~~~~~~-~~p~~~~~~vy~~~~~g~l~a~d~~ 259 (377)
T TIGR03300 188 IA-DGGVL-VGFAGG-KLVALDLQTGQ---PLWEQRVALPKGRTELE-RLVDVD-GDPVVDGGQVYAVSYQGRVAALDLR 259 (377)
T ss_pred EE-CCEEE-EECCCC-EEEEEEccCCC---EeeeeccccCCCCCchh-hhhccC-CccEEECCEEEEEEcCCEEEEEECC
Confidence 44 66555 444333 23233 55542 24532 11100000000 000000 011334788887653 346788998
Q ss_pred CCe--EEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccce
Q 043369 239 NNR--VMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSC 316 (526)
Q Consensus 239 t~~--w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~ 316 (526)
+++ |.. + .. .+ ...++ .+++||+.... ..+
T Consensus 260 tG~~~W~~--~---~~---~~--~~p~~--------------------~~~~vyv~~~~------------------G~l 291 (377)
T TIGR03300 260 SGRVLWKR--D---AS---SY--QGPAV--------------------DDNRLYVTDAD------------------GVV 291 (377)
T ss_pred CCcEEEee--c---cC---Cc--cCceE--------------------eCCEEEEECCC------------------CeE
Confidence 765 432 1 11 11 11111 37888887532 135
Q ss_pred EEEEeecCCCCceecccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC--cEeecCCCCcccc
Q 043369 317 GRLTITAQNPKWEMEEMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN--RFRILSPSLIPRL 394 (526)
Q Consensus 317 ~~~d~~~~~~~W~~~~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~--~Wt~~a~~~~~R~ 394 (526)
.++|..+....|+...+.. +..... ++.+++||+.+ .+ | .+.++|+.+. .|+.-.. ...
T Consensus 292 ~~~d~~tG~~~W~~~~~~~-~~~ssp-~i~g~~l~~~~-~~-G------------~l~~~d~~tG~~~~~~~~~--~~~- 352 (377)
T TIGR03300 292 VALDRRSGSELWKNDELKY-RQLTAP-AVVGGYLVVGD-FE-G------------YLHWLSREDGSFVARLKTD--GSG- 352 (377)
T ss_pred EEEECCCCcEEEccccccC-CccccC-EEECCEEEEEe-CC-C------------EEEEEECCCCCEEEEEEcC--CCc-
Confidence 6788765456787644432 222232 33477777643 22 2 3567888877 3532111 111
Q ss_pred ccccceecCCCEEEEecCC
Q 043369 395 YHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 395 yhs~a~LlpdG~V~v~GG~ 413 (526)
+.+.- ++.|+++|+.+.+
T Consensus 353 ~~~sp-~~~~~~l~v~~~d 370 (377)
T TIGR03300 353 IASPP-VVVGDGLLVQTRD 370 (377)
T ss_pred cccCC-EEECCEEEEEeCC
Confidence 22222 2348898877653
No 60
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=93.53 E-value=11 Score=39.28 Aligned_cols=86 Identities=19% Similarity=0.144 Sum_probs=43.2
Q ss_pred eEEEEeCCCCc--EEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCCcccccceeEE
Q 043369 86 HAVEFDPITRK--VRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLISPRWYASNQI 162 (526)
Q Consensus 86 ~~~~yDp~t~~--w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~~~R~y~s~~~ 162 (526)
....||+++++ |+.- ....+++ +.++.++++|+.... ..+..||+.+ ...|... +...- +.+. +
T Consensus 76 ~v~a~d~~tG~~~W~~~--~~~~~~~-~p~v~~~~v~v~~~~----g~l~ald~~tG~~~W~~~----~~~~~-~~~p-~ 142 (377)
T TIGR03300 76 TVVALDAETGKRLWRVD--LDERLSG-GVGADGGLVFVGTEK----GEVIALDAEDGKELWRAK----LSSEV-LSPP-L 142 (377)
T ss_pred eEEEEEccCCcEeeeec--CCCCccc-ceEEcCCEEEEEcCC----CEEEEEECCCCcEeeeec----cCcee-ecCC-E
Confidence 36778988776 5432 1222332 334446666654332 3688899862 3358653 22111 2222 3
Q ss_pred ecCCcEEEEcCccCCeEEEE-cCCC
Q 043369 163 LPNGKIIVVGGRFQFTYEFI-PRTS 186 (526)
Q Consensus 163 L~dG~v~viGG~~~~~~E~y-P~~~ 186 (526)
+.+++||+..+ + ..+-.+ ++++
T Consensus 143 v~~~~v~v~~~-~-g~l~a~d~~tG 165 (377)
T TIGR03300 143 VANGLVVVRTN-D-GRLTALDAATG 165 (377)
T ss_pred EECCEEEEECC-C-CeEEEEEcCCC
Confidence 34777777543 2 224444 5554
No 61
>KOG2437 consensus Muskelin [Signal transduction mechanisms]
Probab=93.36 E-value=0.11 Score=54.94 Aligned_cols=155 Identities=14% Similarity=0.195 Sum_probs=93.3
Q ss_pred CCcEEEEEccc-------eEEEeccCCeEEEec---cCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEE
Q 043369 221 DGNLFIFANDR-------AILLDYVNNRVMKNY---PVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVL 290 (526)
Q Consensus 221 dG~Iy~~Gg~~-------~~~yDp~t~~w~~~~---p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~ 290 (526)
+.+||+.||.+ -|.|..+.|.|.. + ...|+. |.. .-.|. +-...|+|
T Consensus 272 ~~CiYLYGGWdG~~~l~DFW~Y~v~e~~W~~-iN~~t~~PG~--RsC---HRMVi-----------------d~S~~KLY 328 (723)
T KOG2437|consen 272 TECVYLYGGWDGTQDLADFWAYSVKENQWTC-INRDTEGPGA--RSC---HRMVI-----------------DISRRKLY 328 (723)
T ss_pred CcEEEEecCcccchhHHHHHhhcCCcceeEE-eecCCCCCcc--hhh---hhhhh-----------------hhhHhHHh
Confidence 45999999964 4889999999973 3 234553 542 11121 11256899
Q ss_pred EEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceecccCcc-------ccccceEEeCCCc--EEEEcCcCCCCC
Q 043369 291 ICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEMEEMPLN-------RVMGDMILLPTGD--VLIINGAAKGTA 361 (526)
Q Consensus 291 v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~-------R~~~~~vvLpdG~--V~vvGG~~~g~~ 361 (526)
+.|-.-..+..+. ..+-....++|+. ++.|...+|... =..|+|+|- ..| |||.||....
T Consensus 329 LlG~Y~~sS~r~~------~s~RsDfW~FDi~--~~~W~~ls~dt~~dGGP~~vfDHqM~Vd-~~k~~iyVfGGr~~~-- 397 (723)
T KOG2437|consen 329 LLGRYLDSSVRNS------KSLRSDFWRFDID--TNTWMLLSEDTAADGGPKLVFDHQMCVD-SEKHMIYVFGGRILT-- 397 (723)
T ss_pred hhhhccccccccc------cccccceEEEecC--CceeEEecccccccCCcceeecceeeEe-cCcceEEEecCeecc--
Confidence 9986532111110 1234456788875 589987665543 235666654 445 9999998632
Q ss_pred CccCCCCCccc-cEEEeCCCCcEeecCC----------CCccccccccceecCCCEEEEecCC
Q 043369 362 GWGAAREPVLN-PVIYCPKINRFRILSP----------SLIPRLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 362 g~~~~~~~~~~-~e~YDP~t~~Wt~~a~----------~~~~R~yhs~a~LlpdG~V~v~GG~ 413 (526)
-+++++. ...||-....|..++. -.+.|+.|.+-..-.+.+.|++||.
T Consensus 398 ----~~e~~f~GLYaf~~~~~~w~~l~e~~~~~~~vvE~~~sR~ghcmE~~~~n~~ly~fggq 456 (723)
T KOG2437|consen 398 ----CNEPQFSGLYAFNCQCQTWKLLREDSCNAGPVVEDIQSRIGHCMEFHSKNRCLYVFGGQ 456 (723)
T ss_pred ----CCCccccceEEEecCCccHHHHHHHHhhcCcchhHHHHHHHHHHHhcCCCCeEEeccCc
Confidence 1234443 5678888888875432 2457888887554445556666663
No 62
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=92.91 E-value=11 Score=37.72 Aligned_cols=243 Identities=19% Similarity=0.209 Sum_probs=126.1
Q ss_pred EEEEeCCC-CcEE--eCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcc---cccCCCCCccccccee
Q 043369 87 AVEFDPIT-RKVR--PLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWE---EDHQNGLISPRWYASN 160 (526)
Q Consensus 87 ~~~yDp~t-~~w~--~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~---~~~~~~m~~~R~y~s~ 160 (526)
.-+||.-| ++.- +++..--+-|+ .-|.|..+..||.+ +.+.+|+.. +.+=. .. ...+..-+.|-+.
T Consensus 79 lIvWDs~TtnK~haipl~s~WVMtCA---~sPSg~~VAcGGLd---N~Csiy~ls-~~d~~g~~~v-~r~l~gHtgylSc 150 (343)
T KOG0286|consen 79 LIVWDSFTTNKVHAIPLPSSWVMTCA---YSPSGNFVACGGLD---NKCSIYPLS-TRDAEGNVRV-SRELAGHTGYLSC 150 (343)
T ss_pred EEEEEcccccceeEEecCceeEEEEE---ECCCCCeEEecCcC---ceeEEEecc-ccccccccee-eeeecCccceeEE
Confidence 45677543 3332 33322234444 67899999999985 678889876 33211 22 1235566788888
Q ss_pred EEecC-CcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEec-CCcEEEEEccc--eEEE
Q 043369 161 QILPN-GKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLST-DGNLFIFANDR--AILL 235 (526)
Q Consensus 161 ~~L~d-G~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~-dG~Iy~~Gg~~--~~~y 235 (526)
+...| +.|+.-.|- .+.-.| -.+. . ....+.-.+.|. . .+.+.| +++.|+.|+.+ +.++
T Consensus 151 C~f~dD~~ilT~SGD--~TCalWDie~g-----~-~~~~f~GH~gDV-------~-slsl~p~~~ntFvSg~cD~~aklW 214 (343)
T KOG0286|consen 151 CRFLDDNHILTGSGD--MTCALWDIETG-----Q-QTQVFHGHTGDV-------M-SLSLSPSDGNTFVSGGCDKSAKLW 214 (343)
T ss_pred EEEcCCCceEecCCC--ceEEEEEcccc-----e-EEEEecCCcccE-------E-EEecCCCCCCeEEecccccceeee
Confidence 76665 555544442 345555 3322 1 111111111110 0 123455 89999999854 6788
Q ss_pred eccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccc
Q 043369 236 DYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKS 315 (526)
Q Consensus 236 Dp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s 315 (526)
|.....-.+.+ ++...- -.+....| +|.-++.|--+ .+
T Consensus 215 D~R~~~c~qtF---~ghesD----INsv~ffP------------------~G~afatGSDD-----------------~t 252 (343)
T KOG0286|consen 215 DVRSGQCVQTF---EGHESD----INSVRFFP------------------SGDAFATGSDD-----------------AT 252 (343)
T ss_pred eccCcceeEee---cccccc----cceEEEcc------------------CCCeeeecCCC-----------------ce
Confidence 88877654433 221100 01111222 34444444322 35
Q ss_pred eEEEEeecCCC--CceecccCccccccceEE-eCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCcc
Q 043369 316 CGRLTITAQNP--KWEMEEMPLNRVMGDMIL-LPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIP 392 (526)
Q Consensus 316 ~~~~d~~~~~~--~W~~~~M~~~R~~~~~vv-LpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~ 392 (526)
|-.||++.... .++.++...+= ++|. -..|+++..|..+ +.+++||.-+.+=...=.-..-
T Consensus 253 cRlyDlRaD~~~a~ys~~~~~~gi---tSv~FS~SGRlLfagy~d-------------~~c~vWDtlk~e~vg~L~GHeN 316 (343)
T KOG0286|consen 253 CRLYDLRADQELAVYSHDSIICGI---TSVAFSKSGRLLFAGYDD-------------FTCNVWDTLKGERVGVLAGHEN 316 (343)
T ss_pred eEEEeecCCcEEeeeccCcccCCc---eeEEEcccccEEEeeecC-------------CceeEeeccccceEEEeeccCC
Confidence 77899874211 12222223222 2232 2389999988543 2578899877643322122223
Q ss_pred ccccccceecCCCEEEEecCC
Q 043369 393 RLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 393 R~yhs~a~LlpdG~V~v~GG~ 413 (526)
|. |+--+-|||.-+..|+-
T Consensus 317 Rv--Scl~~s~DG~av~TgSW 335 (343)
T KOG0286|consen 317 RV--SCLGVSPDGMAVATGSW 335 (343)
T ss_pred ee--EEEEECCCCcEEEecch
Confidence 43 55566789998888874
No 63
>PF13854 Kelch_5: Kelch motif
Probab=92.84 E-value=0.12 Score=36.15 Aligned_cols=24 Identities=29% Similarity=0.501 Sum_probs=20.7
Q ss_pred CCcccccceeEEecCCcEEEEcCcc
Q 043369 151 LISPRWYASNQILPNGKIIVVGGRF 175 (526)
Q Consensus 151 m~~~R~y~s~~~L~dG~v~viGG~~ 175 (526)
++.+|+.|++++. +++||+.||..
T Consensus 1 ~P~~R~~hs~~~~-~~~iyi~GG~~ 24 (42)
T PF13854_consen 1 IPSPRYGHSAVVV-GNNIYIFGGYS 24 (42)
T ss_pred CCCCccceEEEEE-CCEEEEEcCcc
Confidence 3568999999888 79999999987
No 64
>PRK13684 Ycf48-like protein; Provisional
Probab=92.48 E-value=11 Score=39.05 Aligned_cols=122 Identities=17% Similarity=0.236 Sum_probs=64.8
Q ss_pred EeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEE-cCCCCCCcccccCCCCCcccc-cceeEEecCCc
Q 043369 90 FDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYL-KPCSDCDWEEDHQNGLISPRW-YASNQILPNGK 167 (526)
Q Consensus 90 yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~y-dp~~t~~W~~~~~~~m~~~R~-y~s~~~L~dG~ 167 (526)
.|....+|+++......-..+....++|+++++|.. | ..++ +.....+|+.. ..+.....+ ..+++..++++
T Consensus 199 ~~~gg~tW~~~~~~~~~~l~~i~~~~~g~~~~vg~~--G---~~~~~s~d~G~sW~~~-~~~~~~~~~~l~~v~~~~~~~ 272 (334)
T PRK13684 199 WEPGQTAWTPHQRNSSRRLQSMGFQPDGNLWMLARG--G---QIRFNDPDDLESWSKP-IIPEITNGYGYLDLAYRTPGE 272 (334)
T ss_pred cCCCCCeEEEeeCCCcccceeeeEcCCCCEEEEecC--C---EEEEccCCCCCccccc-cCCccccccceeeEEEcCCCC
Confidence 344556798887654444445566789999998753 2 2234 22215689875 111111122 23455566788
Q ss_pred EEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc
Q 043369 168 IIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR 231 (526)
Q Consensus 168 v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~ 231 (526)
++++|... .+| ..... .+|...+.... .+.++|. .....++++|+.|+..
T Consensus 273 ~~~~G~~G----~v~~S~d~G---~tW~~~~~~~~------~~~~~~~-~~~~~~~~~~~~G~~G 323 (334)
T PRK13684 273 IWAGGGNG----TLLVSKDGG---KTWEKDPVGEE------VPSNFYK-IVFLDPEKGFVLGQRG 323 (334)
T ss_pred EEEEcCCC----eEEEeCCCC---CCCeECCcCCC------CCcceEE-EEEeCCCceEEECCCc
Confidence 98887642 233 22211 26765532111 1124453 3344578888887754
No 65
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=91.68 E-value=17 Score=36.98 Aligned_cols=90 Identities=8% Similarity=-0.067 Sum_probs=46.1
Q ss_pred EEEEeCC-CCcEEeCccC--CccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCC-c-ccccCCCCCcccccceeE
Q 043369 87 AVEFDPI-TRKVRPLTIQ--TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCD-W-EEDHQNGLISPRWYASNQ 161 (526)
Q Consensus 87 ~~~yDp~-t~~w~~~~~~--~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~-W-~~~~~~~m~~~R~y~s~~ 161 (526)
...|+.. +++++.+... ...-| ..++.++|+.+.+..+. ...+.+||.. ++. . ... ..+.....-++++
T Consensus 59 i~~~~~~~~g~l~~~~~~~~~~~p~-~i~~~~~g~~l~v~~~~--~~~v~v~~~~-~~g~~~~~~--~~~~~~~~~~~~~ 132 (330)
T PRK11028 59 VLSYRIADDGALTFAAESPLPGSPT-HISTDHQGRFLFSASYN--ANCVSVSPLD-KDGIPVAPI--QIIEGLEGCHSAN 132 (330)
T ss_pred EEEEEECCCCceEEeeeecCCCCce-EEEECCCCCEEEEEEcC--CCeEEEEEEC-CCCCCCCce--eeccCCCcccEeE
Confidence 3445554 4556544321 11222 24456788876666543 3567778765 321 1 111 1122222224455
Q ss_pred EecCCcEEEEcCccCCeEEEE
Q 043369 162 ILPNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 162 ~L~dG~v~viGG~~~~~~E~y 182 (526)
.-+||+.+.+.......+.+|
T Consensus 133 ~~p~g~~l~v~~~~~~~v~v~ 153 (330)
T PRK11028 133 IDPDNRTLWVPCLKEDRIRLF 153 (330)
T ss_pred eCCCCCEEEEeeCCCCEEEEE
Confidence 566887776666665678888
No 66
>PF07893 DUF1668: Protein of unknown function (DUF1668); InterPro: IPR012871 The hypothetical proteins found in this family are expressed by Oryza sativa (Rice) and are of unknown function.
Probab=91.57 E-value=2.9 Score=43.43 Aligned_cols=119 Identities=12% Similarity=0.009 Sum_probs=73.5
Q ss_pred EcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccCC---------eEEEE-
Q 043369 113 LLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQF---------TYEFI- 182 (526)
Q Consensus 113 ~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~---------~~E~y- 182 (526)
.+.+.+|+.++.. ..+-+||+. +..-... | .|..+..++.++.+ ++++||+...... .+|.+
T Consensus 73 al~gskIv~~d~~----~~t~vyDt~-t~av~~~-P-~l~~pk~~pisv~V-G~~LY~m~~~~~~~~~~~~~~~~FE~l~ 144 (342)
T PF07893_consen 73 ALHGSKIVAVDQS----GRTLVYDTD-TRAVATG-P-RLHSPKRCPISVSV-GDKLYAMDRSPFPEPAGRPDFPCFEALV 144 (342)
T ss_pred EecCCeEEEEcCC----CCeEEEECC-CCeEecc-C-CCCCCCcceEEEEe-CCeEEEeeccCccccccCccceeEEEec
Confidence 3457788888654 347899999 8877777 3 68888888877777 6789999886421 56665
Q ss_pred --c------CCCCCCCcceeecCCccccCCCCCCCCCCcceEEEec-CCcEEEEEc-c--ceEEEeccCCeEEE
Q 043369 183 --P------RTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLST-DGNLFIFAN-D--RAILLDYVNNRVMK 244 (526)
Q Consensus 183 --P------~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~-dG~Iy~~Gg-~--~~~~yDp~t~~w~~ 244 (526)
+ ....| .|..+|...-..+. ......=..+++. +..||+... . .+..||..+.+|.+
T Consensus 145 ~~~~~~~~~~~~~w---~W~~LP~PPf~~~~--~~~~~~i~sYavv~g~~I~vS~~~~~~GTysfDt~~~~W~~ 213 (342)
T PF07893_consen 145 YRPPPDDPSPEESW---SWRSLPPPPFVRDR--RYSDYRITSYAVVDGRTIFVSVNGRRWGTYSFDTESHEWRK 213 (342)
T ss_pred cccccccccCCCcc---eEEcCCCCCccccC--CcccceEEEEEEecCCeEEEEecCCceEEEEEEcCCcceee
Confidence 1 12234 67766543211110 0000001123444 558888443 4 58899999999984
No 67
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=91.00 E-value=18 Score=36.11 Aligned_cols=148 Identities=17% Similarity=0.108 Sum_probs=75.7
Q ss_pred EEEEeCCCCcEEeCccC---CccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEe
Q 043369 87 AVEFDPITRKVRPLTIQ---TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQIL 163 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~---~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L 163 (526)
...+||++.+.+..+.. .+.--...++-..|.+..+|=.. .--..||. ++.-... +.+ ..-.-.++|+.
T Consensus 126 I~R~dpkt~evt~f~lp~~~a~~nlet~vfD~~G~lWFt~q~G----~yGrLdPa-~~~i~vf-paP--qG~gpyGi~at 197 (353)
T COG4257 126 IGRLDPKTLEVTRFPLPLEHADANLETAVFDPWGNLWFTGQIG----AYGRLDPA-RNVISVF-PAP--QGGGPYGICAT 197 (353)
T ss_pred eEEecCcccceEEeecccccCCCcccceeeCCCccEEEeeccc----cceecCcc-cCceeee-ccC--CCCCCcceEEC
Confidence 45689999888765432 22223345677789999998432 01145665 4433222 112 22223467788
Q ss_pred cCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccc-cCCCCCCCCCCcceEEEecCCcEEEE--EccceEEEeccCC
Q 043369 164 PNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKE-TMHSPKIPNNLYPFLHLSTDGNLFIF--ANDRAILLDYVNN 240 (526)
Q Consensus 164 ~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~-~~~~~~~~~~~yp~~~~~~dG~Iy~~--Gg~~~~~yDp~t~ 240 (526)
+||+|++..=..+.-..+-|... ....++.... +.+. -..+.-+-|++++. |+-+..+|||.+.
T Consensus 198 pdGsvwyaslagnaiaridp~~~-----~aev~p~P~~~~~gs--------Rriwsdpig~~wittwg~g~l~rfdPs~~ 264 (353)
T COG4257 198 PDGSVWYASLAGNAIARIDPFAG-----HAEVVPQPNALKAGS--------RRIWSDPIGRAWITTWGTGSLHRFDPSVT 264 (353)
T ss_pred CCCcEEEEeccccceEEcccccC-----CcceecCCCcccccc--------cccccCccCcEEEeccCCceeeEeCcccc
Confidence 89999987322111111112221 1111111000 0000 01234456777764 4445779999999
Q ss_pred eEEEeccCCCCCCCCcc
Q 043369 241 RVMKNYPVMPGGISRNY 257 (526)
Q Consensus 241 ~w~~~~p~~p~~~~r~y 257 (526)
+|. ..| +|..-+|-|
T Consensus 265 sW~-eyp-LPgs~arpy 279 (353)
T COG4257 265 SWI-EYP-LPGSKARPY 279 (353)
T ss_pred cce-eee-CCCCCCCcc
Confidence 997 453 666545654
No 68
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=89.74 E-value=29 Score=37.01 Aligned_cols=84 Identities=25% Similarity=0.228 Sum_probs=50.9
Q ss_pred EEEEeCCCCcEEeCcc--CCc-cccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCC-CcccccCCCCCcccccceeEE
Q 043369 87 AVEFDPITRKVRPLTI--QTD-TWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDC-DWEEDHQNGLISPRWYASNQI 162 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~--~~~-~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~-~W~~~~~~~m~~~R~y~s~~~ 162 (526)
.-.||..+... +... .+| -+|. ...-.++.|++.||++ -.++.||.. +. .|.. .++..----.++.
T Consensus 135 ~k~~d~s~a~v-~~~l~~htDYVR~g-~~~~~~~hivvtGsYD---g~vrl~DtR-~~~~~v~----elnhg~pVe~vl~ 204 (487)
T KOG0310|consen 135 VKYWDLSTAYV-QAELSGHTDYVRCG-DISPANDHIVVTGSYD---GKVRLWDTR-SLTSRVV----ELNHGCPVESVLA 204 (487)
T ss_pred EEEEEcCCcEE-EEEecCCcceeEee-ccccCCCeEEEecCCC---ceEEEEEec-cCCceeE----EecCCCceeeEEE
Confidence 45577666654 4332 234 3554 3444578899999994 379999988 55 4542 3443332345788
Q ss_pred ecCCcEEEEcCccCCeEEEE
Q 043369 163 LPNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 163 L~dG~v~viGG~~~~~~E~y 182 (526)
|+.|.+++.-|- +.+.+|
T Consensus 205 lpsgs~iasAgG--n~vkVW 222 (487)
T KOG0310|consen 205 LPSGSLIASAGG--NSVKVW 222 (487)
T ss_pred cCCCCEEEEcCC--CeEEEE
Confidence 888766665543 346666
No 69
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=89.48 E-value=20 Score=34.16 Aligned_cols=132 Identities=15% Similarity=0.081 Sum_probs=66.4
Q ss_pred eEEEEeCCCCc--EEeCccCCccccccc--eEcCCCcEEEEcCCCCCccEEEEEcCCCCC--CcccccCCCCCcccccce
Q 043369 86 HAVEFDPITRK--VRPLTIQTDTWCSSG--ALLANGVLVQTGGYRLGERVVRYLKPCSDC--DWEEDHQNGLISPRWYAS 159 (526)
Q Consensus 86 ~~~~yDp~t~~--w~~~~~~~~~fc~~~--~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~--~W~~~~~~~m~~~R~y~s 159 (526)
....+|+.+++ |+.-. ...+.... .+..++++|+..+. ..+..||+. +. .|+.. +..+-...
T Consensus 4 ~l~~~d~~tG~~~W~~~~--~~~~~~~~~~~~~~~~~v~~~~~~----~~l~~~d~~-tG~~~W~~~----~~~~~~~~- 71 (238)
T PF13360_consen 4 TLSALDPRTGKELWSYDL--GPGIGGPVATAVPDGGRVYVASGD----GNLYALDAK-TGKVLWRFD----LPGPISGA- 71 (238)
T ss_dssp EEEEEETTTTEEEEEEEC--SSSCSSEEETEEEETTEEEEEETT----SEEEEEETT-TSEEEEEEE----CSSCGGSG-
T ss_pred EEEEEECCCCCEEEEEEC--CCCCCCccceEEEeCCEEEEEcCC----CEEEEEECC-CCCEEEEee----ccccccce-
Confidence 45678887766 55421 11122222 33467788877433 578899986 43 57654 22221111
Q ss_pred eEEecCCcEEEEcCccCCeEEEE-cCCCCCCCccee-ecCCccccCCCCCCCCCCcceEEEecCCcEEEEE-ccceEEEe
Q 043369 160 NQILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILY-QLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFA-NDRAILLD 236 (526)
Q Consensus 160 ~~~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~-~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~G-g~~~~~yD 236 (526)
. ...+++||+..... .+..+ ..++. ..|. ........ .-..+....+.++++|+.. +.....+|
T Consensus 72 ~-~~~~~~v~v~~~~~--~l~~~d~~tG~---~~W~~~~~~~~~~-------~~~~~~~~~~~~~~~~~~~~~g~l~~~d 138 (238)
T PF13360_consen 72 P-VVDGGRVYVGTSDG--SLYALDAKTGK---VLWSIYLTSSPPA-------GVRSSSSPAVDGDRLYVGTSSGKLVALD 138 (238)
T ss_dssp E-EEETTEEEEEETTS--EEEEEETTTSC---EEEEEEE-SSCTC-------STB--SEEEEETTEEEEEETCSEEEEEE
T ss_pred e-eeccccccccccee--eeEecccCCcc---eeeeecccccccc-------ccccccCceEecCEEEEEeccCcEEEEe
Confidence 2 44588998886432 44555 45552 3565 22110000 0001112222245555554 35577899
Q ss_pred ccCCeE
Q 043369 237 YVNNRV 242 (526)
Q Consensus 237 p~t~~w 242 (526)
+++++-
T Consensus 139 ~~tG~~ 144 (238)
T PF13360_consen 139 PKTGKL 144 (238)
T ss_dssp TTTTEE
T ss_pred cCCCcE
Confidence 998763
No 70
>TIGR01640 F_box_assoc_1 F-box protein interaction domain. This model describes a large family of plant domains, with several hundred members in Arabidopsis thaliana. Most examples are found C-terminal to an F-box (pfam00646), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes. Some members have two copies of this domain.
Probab=88.85 E-value=10 Score=36.55 Aligned_cols=154 Identities=13% Similarity=0.099 Sum_probs=79.8
Q ss_pred CCcEEEEEccceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCC
Q 043369 221 DGNLFIFANDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSN 300 (526)
Q Consensus 221 dG~Iy~~Gg~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~ 300 (526)
||-|.+.......++||.|.+|. .+|..+.. +.++... ...+...+ ...+=||+.+.....+
T Consensus 5 nGLlc~~~~~~~~V~NP~T~~~~-~LP~~~~~--~~~~~~~-~~~~G~d~------------~~~~YKVv~~~~~~~~-- 66 (230)
T TIGR01640 5 DGLICFSYGKRLVVWNPSTGQSR-WLPTPKSR--RSNKESD-TYFLGYDP------------IEKQYKVLCFSDRSGN-- 66 (230)
T ss_pred ceEEEEecCCcEEEECCCCCCEE-ecCCCCCc--ccccccc-eEEEeecc------------cCCcEEEEEEEeecCC--
Confidence 44454433345668999999987 68754432 2221111 11122111 0124577777543210
Q ss_pred chhhhhhcccccccceEEEEeecCCCCceec-ccC-ccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeC
Q 043369 301 ENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMP-LNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCP 378 (526)
Q Consensus 301 ~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~-~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP 378 (526)
.....+++|+.. ++.|... ..+ ........+. .||.+|-+.-...+ ++...+..||-
T Consensus 67 ----------~~~~~~~Vys~~--~~~Wr~~~~~~~~~~~~~~~v~-~~G~lyw~~~~~~~--------~~~~~IvsFDl 125 (230)
T TIGR01640 67 ----------RNQSEHQVYTLG--SNSWRTIECSPPHHPLKSRGVC-INGVLYYLAYTLKT--------NPDYFIVSFDV 125 (230)
T ss_pred ----------CCCccEEEEEeC--CCCccccccCCCCccccCCeEE-ECCEEEEEEEECCC--------CCcEEEEEEEc
Confidence 113467899986 4799874 222 1111112444 49999998743211 12225788999
Q ss_pred CCCcEeecCCCCcccc-cc-ccceecCCCEEEEecCC
Q 043369 379 KINRFRILSPSLIPRL-YH-STAHLLSDGRVLVGGSN 413 (526)
Q Consensus 379 ~t~~Wt~~a~~~~~R~-yh-s~a~LlpdG~V~v~GG~ 413 (526)
.+++|+..-+++..+. .+ ...+..-+|++-++...
T Consensus 126 ~~E~f~~~i~~P~~~~~~~~~~~L~~~~G~L~~v~~~ 162 (230)
T TIGR01640 126 SSERFKEFIPLPCGNSDSVDYLSLINYKGKLAVLKQK 162 (230)
T ss_pred ccceEeeeeecCccccccccceEEEEECCEEEEEEec
Confidence 9999995223333332 11 12233336887776553
No 71
>KOG2437 consensus Muskelin [Signal transduction mechanisms]
Probab=88.25 E-value=0.69 Score=49.17 Aligned_cols=117 Identities=10% Similarity=0.069 Sum_probs=74.9
Q ss_pred CcEEEEcCCCCC---ccEEEEEcCCCCCCcccccC-CCCCcccccceeEEe-cCCcEEEEcCccC----------CeEEE
Q 043369 117 GVLVQTGGYRLG---ERVVRYLKPCSDCDWEEDHQ-NGLISPRWYASNQIL-PNGKIIVVGGRFQ----------FTYEF 181 (526)
Q Consensus 117 G~l~v~GG~~~g---~~~v~~ydp~~t~~W~~~~~-~~m~~~R~y~s~~~L-~dG~v~viGG~~~----------~~~E~ 181 (526)
..||.-||++ | ....+.|.-. .+.|+.... ...+-.|..|-++.- +..|+|.+|-.-. ..+..
T Consensus 273 ~CiYLYGGWd-G~~~l~DFW~Y~v~-e~~W~~iN~~t~~PG~RsCHRMVid~S~~KLYLlG~Y~~sS~r~~~s~RsDfW~ 350 (723)
T KOG2437|consen 273 ECVYLYGGWD-GTQDLADFWAYSVK-ENQWTCINRDTEGPGARSCHRMVIDISRRKLYLLGRYLDSSVRNSKSLRSDFWR 350 (723)
T ss_pred cEEEEecCcc-cchhHHHHHhhcCC-cceeEEeecCCCCCcchhhhhhhhhhhHhHHhhhhhccccccccccccccceEE
Confidence 3899999994 4 3567889988 889997611 135666877766532 2348999986421 12344
Q ss_pred E-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCc--EEEEEccc----------eEEEeccCCeEE
Q 043369 182 I-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGN--LFIFANDR----------AILLDYVNNRVM 243 (526)
Q Consensus 182 y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~--Iy~~Gg~~----------~~~yDp~t~~w~ 243 (526)
| -.++ .|..+.+-.. +++.|.+.|-|..++...| ||++||+. ...||.....|.
T Consensus 351 FDi~~~-----~W~~ls~dt~---~dGGP~~vfDHqM~Vd~~k~~iyVfGGr~~~~~e~~f~GLYaf~~~~~~w~ 417 (723)
T KOG2437|consen 351 FDIDTN-----TWMLLSEDTA---ADGGPKLVFDHQMCVDSEKHMIYVFGGRILTCNEPQFSGLYAFNCQCQTWK 417 (723)
T ss_pred EecCCc-----eeEEeccccc---ccCCcceeecceeeEecCcceEEEecCeeccCCCccccceEEEecCCccHH
Confidence 4 4444 7877765322 1224566777766665555 99999964 245777777776
No 72
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=87.35 E-value=31 Score=33.92 Aligned_cols=220 Identities=14% Similarity=0.101 Sum_probs=107.3
Q ss_pred EcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEe-cCCcEEEEcCccCCeEEEE-cCCCCCCC
Q 043369 113 LLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQIL-PNGKIIVVGGRFQFTYEFI-PRTSDSDR 190 (526)
Q Consensus 113 ~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L-~dG~v~viGG~~~~~~E~y-P~~~~~~~ 190 (526)
..+|++.++++|+ ..|++||-. ++.=... ......+-.-+++-. -|||-...||.++ ++.+| -+...
T Consensus 48 iTpdk~~LAaa~~----qhvRlyD~~-S~np~Pv--~t~e~h~kNVtaVgF~~dgrWMyTgseDg-t~kIWdlR~~~--- 116 (311)
T KOG0315|consen 48 ITPDKKDLAAAGN----QHVRLYDLN-SNNPNPV--ATFEGHTKNVTAVGFQCDGRWMYTGSEDG-TVKIWDLRSLS--- 116 (311)
T ss_pred EcCCcchhhhccC----CeeEEEEcc-CCCCCce--eEEeccCCceEEEEEeecCeEEEecCCCc-eEEEEeccCcc---
Confidence 4578899999987 589999987 5432111 111122222233222 2788888888765 44555 22110
Q ss_pred cceeecCCccccCCCCCCCCCCcce--EEEecCCcEEEEEccc--eEEEeccCCeEEEeccCCCCCCCCccCCCCceeec
Q 043369 191 KILYQLPFLKETMHSPKIPNNLYPF--LHLSTDGNLFIFANDR--AILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLL 266 (526)
Q Consensus 191 ~~w~~~p~l~~~~~~~~~~~~~yp~--~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~l 266 (526)
--...... -|. +++-|+--=+++|.++ .+++|..++.-... .+|... .. -...+++
T Consensus 117 -~qR~~~~~-------------spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~--liPe~~--~~-i~sl~v~- 176 (311)
T KOG0315|consen 117 -CQRNYQHN-------------SPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHE--LIPEDD--TS-IQSLTVM- 176 (311)
T ss_pred -cchhccCC-------------CCcceEEecCCcceEEeecCCCcEEEEEccCCccccc--cCCCCC--cc-eeeEEEc-
Confidence 00001000 011 1222333223345543 57899999865532 234321 10 0122332
Q ss_pred ccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCce-e-cccC----cccccc
Q 043369 267 PVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWE-M-EEMP----LNRVMG 340 (526)
Q Consensus 267 p~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~-~-~~M~----~~R~~~ 340 (526)
.+|+.++.+-.. -+|+++++.. .+-. . +|.. ..|.-.
T Consensus 177 ------------------~dgsml~a~nnk-----------------G~cyvW~l~~--~~~~s~l~P~~k~~ah~~~il 219 (311)
T KOG0315|consen 177 ------------------PDGSMLAAANNK-----------------GNCYVWRLLN--HQTASELEPVHKFQAHNGHIL 219 (311)
T ss_pred ------------------CCCcEEEEecCC-----------------ccEEEEEccC--CCccccceEhhheecccceEE
Confidence 377766654321 2466777642 2111 1 1221 112222
Q ss_pred ceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCc-cccccccceecCCCEEEEecCCCC
Q 043369 341 DMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLI-PRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 341 ~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~-~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
....-||+|.++.-+.++ ++.+|+-+.- +..--.+.- .|---- ++.-.||+-+|.|+..+
T Consensus 220 ~C~lSPd~k~lat~ssdk-------------tv~iwn~~~~-~kle~~l~gh~rWvWd-c~FS~dg~YlvTassd~ 280 (311)
T KOG0315|consen 220 RCLLSPDVKYLATCSSDK-------------TVKIWNTDDF-FKLELVLTGHQRWVWD-CAFSADGEYLVTASSDH 280 (311)
T ss_pred EEEECCCCcEEEeecCCc-------------eEEEEecCCc-eeeEEEeecCCceEEe-eeeccCccEEEecCCCC
Confidence 335669999999887653 5677776655 321111111 121112 23335999999999764
No 73
>PLN00181 protein SPA1-RELATED; Provisional
Probab=87.11 E-value=44 Score=38.81 Aligned_cols=230 Identities=11% Similarity=0.021 Sum_probs=107.3
Q ss_pred ceEcCCCcEEEEcCCCCCccEEEEEcCCCCC--Cccccc-C-CCCCcccccceeEEec-CCcEEEEcCccCCeEEEE-cC
Q 043369 111 GALLANGVLVQTGGYRLGERVVRYLKPCSDC--DWEEDH-Q-NGLISPRWYASNQILP-NGKIIVVGGRFQFTYEFI-PR 184 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~--~W~~~~-~-~~m~~~R~y~s~~~L~-dG~v~viGG~~~~~~E~y-P~ 184 (526)
..+-+||+++++||.+ ..+.+||.. +. .....+ + ..+.....-.+.+-.+ ++..++.|+.++ ++.+| ..
T Consensus 489 i~fs~dg~~latgg~D---~~I~iwd~~-~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~Dg-~v~lWd~~ 563 (793)
T PLN00181 489 IGFDRDGEFFATAGVN---KKIKIFECE-SIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNFEG-VVQVWDVA 563 (793)
T ss_pred EEECCCCCEEEEEeCC---CEEEEEECC-cccccccccccceEEecccCceeeEEeccCCCCEEEEEeCCC-eEEEEECC
Confidence 4556799999999974 578888864 21 111110 0 0111100001111111 356777777653 56677 33
Q ss_pred CCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCeEEEeccCCCCCCCCccCCCCc
Q 043369 185 TSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNRVMKNYPVMPGGISRNYPSTGS 262 (526)
Q Consensus 185 ~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~ 262 (526)
+. .. +..+.... ...+...+.-.++.+++.|+.+ ..+||..++.-...+ ... . .-.
T Consensus 564 ~~-----~~--~~~~~~H~------~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~---~~~---~---~v~ 621 (793)
T PLN00181 564 RS-----QL--VTEMKEHE------KRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTI---KTK---A---NIC 621 (793)
T ss_pred CC-----eE--EEEecCCC------CCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEE---ecC---C---CeE
Confidence 32 11 10011100 0111111222378888888754 678888765533222 110 0 011
Q ss_pred eeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceecccCccccccce
Q 043369 263 SVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEMEEMPLNRVMGDM 342 (526)
Q Consensus 263 ~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~R~~~~~ 342 (526)
++..+ ..+++.+++|+.+. .+..||+........... .+. .....
T Consensus 622 ~v~~~----------------~~~g~~latgs~dg-----------------~I~iwD~~~~~~~~~~~~-~h~-~~V~~ 666 (793)
T PLN00181 622 CVQFP----------------SESGRSLAFGSADH-----------------KVYYYDLRNPKLPLCTMI-GHS-KTVSY 666 (793)
T ss_pred EEEEe----------------CCCCCEEEEEeCCC-----------------eEEEEECCCCCccceEec-CCC-CCEEE
Confidence 22110 12578888887651 356788753111111111 111 11122
Q ss_pred EEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC----cEeecCCCCccccccccceecCCCEEEEecCCCC
Q 043369 343 ILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN----RFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 343 vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~----~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
+...++..++.++.+ + ++.+||..+. .|..+...........+..+-++|+.+++|+...
T Consensus 667 v~f~~~~~lvs~s~D-~------------~ikiWd~~~~~~~~~~~~l~~~~gh~~~i~~v~~s~~~~~lasgs~D~ 730 (793)
T PLN00181 667 VRFVDSSTLVSSSTD-N------------TLKLWDLSMSISGINETPLHSFMGHTNVKNFVGLSVSDGYIATGSETN 730 (793)
T ss_pred EEEeCCCEEEEEECC-C------------EEEEEeCCCCccccCCcceEEEcCCCCCeeEEEEcCCCCEEEEEeCCC
Confidence 444588888888754 1 4678887653 2322221111011112234567899999998644
No 74
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=87.05 E-value=37 Score=34.44 Aligned_cols=138 Identities=9% Similarity=-0.041 Sum_probs=64.8
Q ss_pred EEEEeCCC-CcEEeCccCCc-cccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEec
Q 043369 87 AVEFDPIT-RKVRPLTIQTD-TWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILP 164 (526)
Q Consensus 87 ~~~yDp~t-~~w~~~~~~~~-~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~ 164 (526)
..+||..+ ++++.+..... .....-+.-+||+.+.+|+.. ...+..|+...+.++... ...+.+..-..++.-+
T Consensus 14 I~~~~~~~~g~l~~~~~~~~~~~~~~l~~spd~~~lyv~~~~--~~~i~~~~~~~~g~l~~~--~~~~~~~~p~~i~~~~ 89 (330)
T PRK11028 14 IHVWNLNHEGALTLLQVVDVPGQVQPMVISPDKRHLYVGVRP--EFRVLSYRIADDGALTFA--AESPLPGSPTHISTDH 89 (330)
T ss_pred EEEEEECCCCceeeeeEEecCCCCccEEECCCCCEEEEEECC--CCcEEEEEECCCCceEEe--eeecCCCCceEEEECC
Confidence 45677653 45554443221 111123445688876666543 245666766413445433 2222222212345556
Q ss_pred CCcEEEEcCccCCeEEEE-cCCCCCCCcce-eecCCccccCCCCCCCCCCcceEE-EecCCcEEEEEc---cceEEEecc
Q 043369 165 NGKIIVVGGRFQFTYEFI-PRTSDSDRKIL-YQLPFLKETMHSPKIPNNLYPFLH-LSTDGNLFIFAN---DRAILLDYV 238 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y-P~~~~~~~~~w-~~~p~l~~~~~~~~~~~~~yp~~~-~~~dG~Iy~~Gg---~~~~~yDp~ 238 (526)
||+.+.+.......+-+| ..++. .. .....+. ....|+.. +.+||+.+++.+ ....+||..
T Consensus 90 ~g~~l~v~~~~~~~v~v~~~~~~g----~~~~~~~~~~---------~~~~~~~~~~~p~g~~l~v~~~~~~~v~v~d~~ 156 (330)
T PRK11028 90 QGRFLFSASYNANCVSVSPLDKDG----IPVAPIQIIE---------GLEGCHSANIDPDNRTLWVPCLKEDRIRLFTLS 156 (330)
T ss_pred CCCEEEEEEcCCCeEEEEEECCCC----CCCCceeecc---------CCCcccEeEeCCCCCEEEEeeCCCCEEEEEEEC
Confidence 887666655444455666 33221 11 1111110 01134443 456776555543 457889987
Q ss_pred CCe
Q 043369 239 NNR 241 (526)
Q Consensus 239 t~~ 241 (526)
++.
T Consensus 157 ~~g 159 (330)
T PRK11028 157 DDG 159 (330)
T ss_pred CCC
Confidence 643
No 75
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=85.98 E-value=22 Score=34.49 Aligned_cols=144 Identities=21% Similarity=0.176 Sum_probs=74.7
Q ss_pred EEEeCCCCcEEeCccC-----CccccccceEcCCCcEEEEcCCC--C-Cc--cEEEEEcCCCCCCcccccCCCCCccccc
Q 043369 88 VEFDPITRKVRPLTIQ-----TDTWCSSGALLANGVLVQTGGYR--L-GE--RVVRYLKPCSDCDWEEDHQNGLISPRWY 157 (526)
Q Consensus 88 ~~yDp~t~~w~~~~~~-----~~~fc~~~~~l~~G~l~v~GG~~--~-g~--~~v~~ydp~~t~~W~~~~~~~m~~~R~y 157 (526)
.++|+.+++++.+... ...++...++.++|++|+.-=.. . .. -.+.++++. .+.... ...|..+
T Consensus 63 ~~~d~~~g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~--~~~~~~-~~~~~~p--- 136 (246)
T PF08450_consen 63 AVVDPDTGKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD--GKVTVV-ADGLGFP--- 136 (246)
T ss_dssp EEEETTTTEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT--SEEEEE-EEEESSE---
T ss_pred EEEecCCCcEEEEeeccCCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC--CeEEEE-ecCcccc---
Confidence 4569999998877643 45677788899999999863211 1 11 357888885 233332 1233322
Q ss_pred ceeEEecCCcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEE-EecCCcEEEE--EccceE
Q 043369 158 ASNQILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLH-LSTDGNLFIF--ANDRAI 233 (526)
Q Consensus 158 ~s~~~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~-~~~dG~Iy~~--Gg~~~~ 233 (526)
.+.+.-+||+.+.+.-+....+..| ..... ..+........... ..-+|-.. +-.+|+||+. ++....
T Consensus 137 NGi~~s~dg~~lyv~ds~~~~i~~~~~~~~~---~~~~~~~~~~~~~~-----~~g~pDG~~vD~~G~l~va~~~~~~I~ 208 (246)
T PF08450_consen 137 NGIAFSPDGKTLYVADSFNGRIWRFDLDADG---GELSNRRVFIDFPG-----GPGYPDGLAVDSDGNLWVADWGGGRIV 208 (246)
T ss_dssp EEEEEETTSSEEEEEETTTTEEEEEEEETTT---CCEEEEEEEEE-SS-----SSCEEEEEEEBTTS-EEEEEETTTEEE
T ss_pred cceEECCcchheeecccccceeEEEeccccc---cceeeeeeEEEcCC-----CCcCCCcceEcCCCCEEEEEcCCCEEE
Confidence 3566667887555443333345555 33221 01211100000000 01134433 3458999987 566789
Q ss_pred EEeccCCeEEEec
Q 043369 234 LLDYVNNRVMKNY 246 (526)
Q Consensus 234 ~yDp~t~~w~~~~ 246 (526)
+|||. ++-...+
T Consensus 209 ~~~p~-G~~~~~i 220 (246)
T PF08450_consen 209 VFDPD-GKLLREI 220 (246)
T ss_dssp EEETT-SCEEEEE
T ss_pred EECCC-ccEEEEE
Confidence 99999 4433334
No 76
>PF07893 DUF1668: Protein of unknown function (DUF1668); InterPro: IPR012871 The hypothetical proteins found in this family are expressed by Oryza sativa (Rice) and are of unknown function.
Probab=85.56 E-value=26 Score=36.38 Aligned_cols=60 Identities=18% Similarity=0.148 Sum_probs=43.3
Q ss_pred eeEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCccccccceEcCCCcEE
Q 043369 41 AMHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLV 120 (526)
Q Consensus 41 ~~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~ 120 (526)
.|+.+.+.+.||+.++.. ..+.+||++|.....++.+....+...++-..++||
T Consensus 68 ~~~F~al~gskIv~~d~~--------------------------~~t~vyDt~t~av~~~P~l~~pk~~pisv~VG~~LY 121 (342)
T PF07893_consen 68 SMDFFALHGSKIVAVDQS--------------------------GRTLVYDTDTRAVATGPRLHSPKRCPISVSVGDKLY 121 (342)
T ss_pred eeEEEEecCCeEEEEcCC--------------------------CCeEEEECCCCeEeccCCCCCCCcceEEEEeCCeEE
Confidence 456665678898888654 136789999999999988765544445555577899
Q ss_pred EEcCCC
Q 043369 121 QTGGYR 126 (526)
Q Consensus 121 v~GG~~ 126 (526)
+.....
T Consensus 122 ~m~~~~ 127 (342)
T PF07893_consen 122 AMDRSP 127 (342)
T ss_pred EeeccC
Confidence 987753
No 77
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=85.35 E-value=12 Score=36.42 Aligned_cols=25 Identities=20% Similarity=0.357 Sum_probs=20.9
Q ss_pred cCCcEEEEEccceEEEeccCCeEEE
Q 043369 220 TDGNLFIFANDRAILLDYVNNRVMK 244 (526)
Q Consensus 220 ~dG~Iy~~Gg~~~~~yDp~t~~w~~ 244 (526)
.+|++|+.......++|+.++++..
T Consensus 50 ~~g~l~v~~~~~~~~~d~~~g~~~~ 74 (246)
T PF08450_consen 50 PDGRLYVADSGGIAVVDPDTGKVTV 74 (246)
T ss_dssp TTSEEEEEETTCEEEEETTTTEEEE
T ss_pred cCCEEEEEEcCceEEEecCCCcEEE
Confidence 5899998887777888999998873
No 78
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=85.09 E-value=41 Score=33.14 Aligned_cols=51 Identities=16% Similarity=0.201 Sum_probs=32.3
Q ss_pred ceEEEEeCCCCcEEeCccC--CccccccceEcCCCcEEEEcCCCCCccEEEEEcCC
Q 043369 85 AHAVEFDPITRKVRPLTIQ--TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPC 138 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~~~~--~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~ 138 (526)
.++.+||..+++=.|+... +..--..-.+-.||+++..||.+ | .++++|-.
T Consensus 61 qhvRlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgseD-g--t~kIWdlR 113 (311)
T KOG0315|consen 61 QHVRLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGSED-G--TVKIWDLR 113 (311)
T ss_pred CeeEEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecCCC-c--eEEEEecc
Confidence 4688999988765444321 21111223455699999999973 3 57777765
No 79
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=84.61 E-value=16 Score=34.76 Aligned_cols=140 Identities=19% Similarity=0.284 Sum_probs=73.1
Q ss_pred EecCCcEEEEE-ccceEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCC
Q 043369 218 LSTDGNLFIFA-NDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTL 296 (526)
Q Consensus 218 ~~~dG~Iy~~G-g~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~ 296 (526)
+..+|++|+.. .....+||.++++..... .++.. .. ..-+. .+++||+....
T Consensus 33 ~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~-~~~~~---~~---~~~~~-------------------~~~~v~v~~~~- 85 (238)
T PF13360_consen 33 VPDGGRVYVASGDGNLYALDAKTGKVLWRF-DLPGP---IS---GAPVV-------------------DGGRVYVGTSD- 85 (238)
T ss_dssp EEETTEEEEEETTSEEEEEETTTSEEEEEE-ECSSC---GG---SGEEE-------------------ETTEEEEEETT-
T ss_pred EEeCCEEEEEcCCCEEEEEECCCCCEEEEe-ecccc---cc---ceeee-------------------cccccccccce-
Confidence 34688888873 345688999887643222 22321 11 11111 47888877632
Q ss_pred CCCCchhhhhhcccccccceEEEEeecCCCCcee-c-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccE
Q 043369 297 PDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEM-E-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPV 374 (526)
Q Consensus 297 ~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~-~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e 374 (526)
..+.++|..+....|+. . .-+..+.........+|..++++... + .+.
T Consensus 86 -----------------~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-g------------~l~ 135 (238)
T PF13360_consen 86 -----------------GSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTSS-G------------KLV 135 (238)
T ss_dssp -----------------SEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEETC-S------------EEE
T ss_pred -----------------eeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEecc-C------------cEE
Confidence 13567886655667984 3 32333322222222244444444422 1 468
Q ss_pred EEeCCCC--cEeecCCCCcc-----cccc-ccceecCCCEEEEecCCC
Q 043369 375 IYCPKIN--RFRILSPSLIP-----RLYH-STAHLLSDGRVLVGGSNP 414 (526)
Q Consensus 375 ~YDP~t~--~Wt~~a~~~~~-----R~yh-s~a~LlpdG~V~v~GG~~ 414 (526)
.+|+++. .|+.-...+.. +... ....++.+|+||+..+..
T Consensus 136 ~~d~~tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~g 183 (238)
T PF13360_consen 136 ALDPKTGKLLWKYPVGEPRGSSPISSFSDINGSPVISDGRVYVSSGDG 183 (238)
T ss_dssp EEETTTTEEEEEEESSTT-SS--EEEETTEEEEEECCTTEEEEECCTS
T ss_pred EEecCCCcEEEEeecCCCCCCcceeeecccccceEEECCEEEEEcCCC
Confidence 8999988 58764333211 0111 234445578999988754
No 80
>COG5184 ATS1 Alpha-tubulin suppressor and related RCC1 domain-containing proteins [Cell division and chromosome partitioning / Cytoskeleton]
Probab=79.60 E-value=94 Score=33.41 Aligned_cols=83 Identities=14% Similarity=0.107 Sum_probs=46.9
Q ss_pred EEeCCCCcEEeCcc--CCcccccc-ceE--cCCCcEEEEcCCCCCc--cEE-----------EEEcCCCCCCcccccCCC
Q 043369 89 EFDPITRKVRPLTI--QTDTWCSS-GAL--LANGVLVQTGGYRLGE--RVV-----------RYLKPCSDCDWEEDHQNG 150 (526)
Q Consensus 89 ~yDp~t~~w~~~~~--~~~~fc~~-~~~--l~~G~l~v~GG~~~g~--~~v-----------~~ydp~~t~~W~~~~~~~ 150 (526)
+++|.-+.|..+.. .....|.+ ++. -.||.||.-|=..+|. +.+ .-+|.. ...|+.. .
T Consensus 90 ~~~P~~~~~~~~d~~~i~~~acGg~hsl~ld~Dg~lyswG~N~~G~Lgr~~~~~~~~~~~~~~~~~~~-~~~~tP~---~ 165 (476)
T COG5184 90 VDRPQLNPFGRIDKASIIKIACGGNHSLGLDHDGNLYSWGDNDDGALGRDIHKDICDQNNDIIDFDDY-ELESTPF---K 165 (476)
T ss_pred ccCceecCcccccceeeEEeecCCceEEeecCCCCEEEeccCcccccccccccccccccccccccchh-hcccCCc---e
Confidence 68888888775443 34555652 222 2379999999654442 111 112222 1223221 1
Q ss_pred CCc--------------ccccceeEEecCCcEEEEcCcc
Q 043369 151 LIS--------------PRWYASNQILPNGKIIVVGGRF 175 (526)
Q Consensus 151 m~~--------------~R~y~s~~~L~dG~v~viGG~~ 175 (526)
|+. .-|..+++...||+||..|...
T Consensus 166 v~~~s~~~s~~~vv~l~cg~e~svil~~~G~V~~~gt~r 204 (476)
T COG5184 166 VPGGSSAKSHLRVVKLACGWEISVILTADGRVYSWGTFR 204 (476)
T ss_pred eeccccccCChheEEeecCCceEEEEccCCcEEEecCcc
Confidence 221 2356788888899999999843
No 81
>PF13088 BNR_2: BNR repeat-like domain; PDB: 2F11_A 2F0Z_A 1VCU_B 2F25_B 1SO7_A 2F29_A 1SNT_A 2F13_A 2F28_A 2F27_A ....
Probab=78.92 E-value=8.2 Score=38.09 Aligned_cols=119 Identities=18% Similarity=0.225 Sum_probs=63.6
Q ss_pred CcEEEcccC-CccceeEEEEe--cCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeC-CCCcEEeCc--
Q 043369 28 GKWKLLKRS-IGVSAMHMALL--PNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDP-ITRKVRPLT-- 101 (526)
Q Consensus 28 g~W~~~~~~-~~v~~~~~a~l--~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp-~t~~w~~~~-- 101 (526)
-.|+..... ......+.+++ ++|+++++-+.+ +... ....+-. .-.+|++..
T Consensus 145 ~tW~~~~~~~~~~~~~e~~~~~~~dG~l~~~~R~~-~~~~---------------------~~~~~S~D~G~TWs~~~~~ 202 (275)
T PF13088_consen 145 KTWSSGSPIPDGQGECEPSIVELPDGRLLAVFRTE-GNDD---------------------IYISRSTDGGRTWSPPQPT 202 (275)
T ss_dssp SSEEEEEECECSEEEEEEEEEEETTSEEEEEEEEC-SSTE---------------------EEEEEESSTTSS-EEEEEE
T ss_pred ceeeccccccccCCcceeEEEECCCCcEEEEEEcc-CCCc---------------------EEEEEECCCCCcCCCceec
Confidence 459876532 12244555544 799999998874 2110 0111111 223566533
Q ss_pred cCCccccc-cceEcCCCcEEEEcCCCCCccEEEEE-cCCCCCCcccccCCCCCccc----ccceeEEecCCcEEE
Q 043369 102 IQTDTWCS-SGALLANGVLVQTGGYRLGERVVRYL-KPCSDCDWEEDHQNGLISPR----WYASNQILPNGKIIV 170 (526)
Q Consensus 102 ~~~~~fc~-~~~~l~~G~l~v~GG~~~g~~~v~~y-dp~~t~~W~~~~~~~m~~~R----~y~s~~~L~dG~v~v 170 (526)
..++.-|. ....+.+|+++++....++...+.++ ......+|... ..+.... .|++++.+.||+|+|
T Consensus 203 ~~~~~~~~~~~~~~~~g~~~~~~~~~~~r~~l~l~~S~D~g~tW~~~--~~i~~~~~~~~~Y~~~~~~~dg~l~i 275 (275)
T PF13088_consen 203 NLPNPNSSISLVRLSDGRLLLVYNNPDGRSNLSLYVSEDGGKTWSRP--KTIDDGPNGDSGYPSLTQLPDGKLYI 275 (275)
T ss_dssp ECSSCCEEEEEEECTTSEEEEEEECSSTSEEEEEEEECTTCEEEEEE--EEEEEEE-CCEEEEEEEEEETTEEEE
T ss_pred ccCcccCCceEEEcCCCCEEEEEECCCCCCceEEEEEeCCCCcCCcc--EEEeCCCCCcEECCeeEEeCCCcCCC
Confidence 12222222 22346789999988743333333332 22216789865 2343333 699999999999987
No 82
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=78.52 E-value=58 Score=30.42 Aligned_cols=135 Identities=15% Similarity=0.174 Sum_probs=63.9
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCC-cccccceeEEec
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLI-SPRWYASNQILP 164 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~-~~R~y~s~~~L~ 164 (526)
...+||..+++....-..+..........++++++++|+.. ..+.+||.. +.+-... +. ....-.+....+
T Consensus 74 ~i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~---~~i~~~~~~-~~~~~~~----~~~~~~~i~~~~~~~ 145 (289)
T cd00200 74 TIRLWDLETGECVRTLTGHTSYVSSVAFSPDGRILSSSSRD---KTIKVWDVE-TGKCLTT----LRGHTDWVNSVAFSP 145 (289)
T ss_pred eEEEEEcCcccceEEEeccCCcEEEEEEcCCCCEEEEecCC---CeEEEEECC-CcEEEEE----eccCCCcEEEEEEcC
Confidence 46678877643221111222122223445567888888732 478889986 4332211 21 111222344444
Q ss_pred CCcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc--ceEEEeccCCe
Q 043369 165 NGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND--RAILLDYVNNR 241 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~--~~~~yDp~t~~ 241 (526)
++++++.|..+ ..+.+| ..+.. ....+.... .... .....++++.+++++. ...+||..+.+
T Consensus 146 ~~~~l~~~~~~-~~i~i~d~~~~~----~~~~~~~~~---------~~i~-~~~~~~~~~~l~~~~~~~~i~i~d~~~~~ 210 (289)
T cd00200 146 DGTFVASSSQD-GTIKLWDLRTGK----CVATLTGHT---------GEVN-SVAFSPDGEKLLSSSSDGTIKLWDLSTGK 210 (289)
T ss_pred cCCEEEEEcCC-CcEEEEEccccc----cceeEecCc---------cccc-eEEECCCcCEEEEecCCCcEEEEECCCCc
Confidence 56766665533 345666 43221 111111000 0011 2334567766666653 46788888765
Q ss_pred EE
Q 043369 242 VM 243 (526)
Q Consensus 242 w~ 243 (526)
..
T Consensus 211 ~~ 212 (289)
T cd00200 211 CL 212 (289)
T ss_pred ee
Confidence 43
No 83
>PF13088 BNR_2: BNR repeat-like domain; PDB: 2F11_A 2F0Z_A 1VCU_B 2F25_B 1SO7_A 2F29_A 1SNT_A 2F13_A 2F28_A 2F27_A ....
Probab=78.31 E-value=24 Score=34.71 Aligned_cols=129 Identities=16% Similarity=0.161 Sum_probs=70.3
Q ss_pred eCCCCcEEeCccC-C-ccccccc-eEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCc
Q 043369 91 DPITRKVRPLTIQ-T-DTWCSSG-ALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGK 167 (526)
Q Consensus 91 Dp~t~~w~~~~~~-~-~~fc~~~-~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~ 167 (526)
|-.-.+|+..... . ...|... +.+.||+|+++--..........+......+|.+..+..++.+........+.+|+
T Consensus 141 ~D~G~tW~~~~~~~~~~~~~e~~~~~~~dG~l~~~~R~~~~~~~~~~~S~D~G~TWs~~~~~~~~~~~~~~~~~~~~~g~ 220 (275)
T PF13088_consen 141 DDGGKTWSSGSPIPDGQGECEPSIVELPDGRLLAVFRTEGNDDIYISRSTDGGRTWSPPQPTNLPNPNSSISLVRLSDGR 220 (275)
T ss_dssp SSTTSSEEEEEECECSEEEEEEEEEEETTSEEEEEEEECSSTEEEEEEESSTTSS-EEEEEEECSSCCEEEEEEECTTSE
T ss_pred CCCCceeeccccccccCCcceeEEEECCCCcEEEEEEccCCCcEEEEEECCCCCcCCCceecccCcccCCceEEEcCCCC
Confidence 3344569876644 2 2334333 34689999998643201122222333225689875222566666556667788999
Q ss_pred EEEEcCccC--CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEE
Q 043369 168 IIVVGGRFQ--FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFI 226 (526)
Q Consensus 168 v~viGG~~~--~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~ 226 (526)
++++..... ...-++ ...+. .+|...-.+.... .....||.+....||+|++
T Consensus 221 ~~~~~~~~~~r~~l~l~~S~D~g---~tW~~~~~i~~~~----~~~~~Y~~~~~~~dg~l~i 275 (275)
T PF13088_consen 221 LLLVYNNPDGRSNLSLYVSEDGG---KTWSRPKTIDDGP----NGDSGYPSLTQLPDGKLYI 275 (275)
T ss_dssp EEEEEECSSTSEEEEEEEECTTC---EEEEEEEEEEEEE-----CCEEEEEEEEEETTEEEE
T ss_pred EEEEEECCCCCCceEEEEEeCCC---CcCCccEEEeCCC----CCcEECCeeEEeCCCcCCC
Confidence 999988422 233444 22211 3676432232211 0124699999999999986
No 84
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=77.70 E-value=1.1e+02 Score=33.04 Aligned_cols=117 Identities=21% Similarity=0.196 Sum_probs=67.4
Q ss_pred CCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCc-ccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEE
Q 043369 103 QTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDW-EEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEF 181 (526)
Q Consensus 103 ~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W-~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~ 181 (526)
.+...+.....-+||+.++.|..+ ..+++||......- ..+ ..+.... .+++.-++|+.++.|+.++ ++.+
T Consensus 201 ~h~~~v~~~~fs~d~~~l~s~s~D---~tiriwd~~~~~~~~~~l--~gH~~~v--~~~~f~p~g~~i~Sgs~D~-tvri 272 (456)
T KOG0266|consen 201 GHTRGVSDVAFSPDGSYLLSGSDD---KTLRIWDLKDDGRNLKTL--KGHSTYV--TSVAFSPDGNLLVSGSDDG-TVRI 272 (456)
T ss_pred ccccceeeeEECCCCcEEEEecCC---ceEEEeeccCCCeEEEEe--cCCCCce--EEEEecCCCCEEEEecCCC-cEEE
Confidence 466777778888999987777653 68899998412122 122 1233223 4555566787777777654 5677
Q ss_pred E-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCe
Q 043369 182 I-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNR 241 (526)
Q Consensus 182 y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~ 241 (526)
| .++.. .-..++.-... --.+..-+||++++.+..+ ..+||..++.
T Consensus 273 Wd~~~~~----~~~~l~~hs~~----------is~~~f~~d~~~l~s~s~d~~i~vwd~~~~~ 321 (456)
T KOG0266|consen 273 WDVRTGE----CVRKLKGHSDG----------ISGLAFSPDGNLLVSASYDGTIRVWDLETGS 321 (456)
T ss_pred EeccCCe----EEEeeeccCCc----------eEEEEECCCCCEEEEcCCCccEEEEECCCCc
Confidence 7 44331 11122211100 0012234588888888644 5789998876
No 85
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=77.11 E-value=55 Score=32.29 Aligned_cols=175 Identities=16% Similarity=0.178 Sum_probs=87.5
Q ss_pred ceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCC---cccccceeEE-ecCCcEEEEcCccCCeEEEE-cCC
Q 043369 111 GALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLI---SPRWYASNQI-LPNGKIIVVGGRFQFTYEFI-PRT 185 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~---~~R~y~s~~~-L~dG~v~viGG~~~~~~E~y-P~~ 185 (526)
.++.-|-.-+++||.. +-+++||-. ..+ . .+|. .+|.--.+.- +.|..|+ .. .+..++..| -++
T Consensus 106 ~af~~ds~~lltgg~e---kllrvfdln-~p~---A--pp~E~~ghtg~Ir~v~wc~eD~~iL-SS-add~tVRLWD~rT 174 (334)
T KOG0278|consen 106 VAFSQDSNYLLTGGQE---KLLRVFDLN-RPK---A--PPKEISGHTGGIRTVLWCHEDKCIL-SS-ADDKTVRLWDHRT 174 (334)
T ss_pred EEecccchhhhccchH---HHhhhhhcc-CCC---C--CchhhcCCCCcceeEEEeccCceEE-ee-ccCCceEEEEecc
Confidence 3455577778888874 667888865 221 1 1222 1222122222 2343333 33 555678888 555
Q ss_pred CCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEE-ccceEEEeccCCeEEEeccCCCCCCCCccCCCCcee
Q 043369 186 SDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFA-NDRAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSV 264 (526)
Q Consensus 186 ~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~G-g~~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v 264 (526)
++ .-..+.+.... -.+-+..||+|..++ |.++..+|+++-.-.+.. .||.. -.++.
T Consensus 175 gt----~v~sL~~~s~V-----------tSlEvs~dG~ilTia~gssV~Fwdaksf~~lKs~-k~P~n-------V~SAS 231 (334)
T KOG0278|consen 175 GT----EVQSLEFNSPV-----------TSLEVSQDGRILTIAYGSSVKFWDAKSFGLLKSY-KMPCN-------VESAS 231 (334)
T ss_pred Cc----EEEEEecCCCC-----------cceeeccCCCEEEEecCceeEEeccccccceeec-cCccc-------ccccc
Confidence 41 11122111000 012356699999887 456777888875533222 34443 12344
Q ss_pred ecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceecccCccc--cccce
Q 043369 265 LLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEMEEMPLNR--VMGDM 342 (526)
Q Consensus 265 ~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~R--~~~~~ 342 (526)
|-| +-.+|||||.+. -+.+||-... .. .+.-.... --|+.
T Consensus 232 L~P------------------~k~~fVaGged~-----------------~~~kfDy~Tg-eE--i~~~nkgh~gpVhcV 273 (334)
T KOG0278|consen 232 LHP------------------KKEFFVAGGEDF-----------------KVYKFDYNTG-EE--IGSYNKGHFGPVHCV 273 (334)
T ss_pred ccC------------------CCceEEecCcce-----------------EEEEEeccCC-ce--eeecccCCCCceEEE
Confidence 433 458999999752 1346765421 11 11111111 11232
Q ss_pred EEeCCCcEEEEcCcC
Q 043369 343 ILLPTGDVLIINGAA 357 (526)
Q Consensus 343 vvLpdG~V~vvGG~~ 357 (526)
---|||.+|..|-.+
T Consensus 274 rFSPdGE~yAsGSED 288 (334)
T KOG0278|consen 274 RFSPDGELYASGSED 288 (334)
T ss_pred EECCCCceeeccCCC
Confidence 245999999987654
No 86
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=75.20 E-value=1.2e+02 Score=32.26 Aligned_cols=122 Identities=16% Similarity=0.109 Sum_probs=63.9
Q ss_pred EEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCC-----CcccccCCCCCcccc-cceeEE
Q 043369 89 EFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDC-----DWEEDHQNGLISPRW-YASNQI 162 (526)
Q Consensus 89 ~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~-----~W~~~~~~~m~~~R~-y~s~~~ 162 (526)
.+|.....|.++.......-.+.....+|.++++|... .....-| . .. +|.+. +++..+. ..++..
T Consensus 264 s~d~G~~~W~~~~~~~~~~l~~v~~~~dg~l~l~g~~G---~l~~S~d-~-G~~~~~~~f~~~---~~~~~~~~l~~v~~ 335 (398)
T PLN00033 264 TWEPGQPYWQPHNRASARRIQNMGWRADGGLWLLTRGG---GLYVSKG-T-GLTEEDFDFEEA---DIKSRGFGILDVGY 335 (398)
T ss_pred ecCCCCcceEEecCCCccceeeeeEcCCCCEEEEeCCc---eEEEecC-C-CCcccccceeec---ccCCCCcceEEEEE
Confidence 35555555888876554444455667899999988542 1111122 2 23 34444 2332332 334555
Q ss_pred ecCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc
Q 043369 163 LPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR 231 (526)
Q Consensus 163 L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~ 231 (526)
..|+.++++|.... .+....+. .+|...+.... .+.++|. +....+++.|+.|.+.
T Consensus 336 ~~d~~~~a~G~~G~---v~~s~D~G---~tW~~~~~~~~------~~~~ly~-v~f~~~~~g~~~G~~G 391 (398)
T PLN00033 336 RSKKEAWAAGGSGI---LLRSTDGG---KSWKRDKGADN------IAANLYS-VKFFDDKKGFVLGNDG 391 (398)
T ss_pred cCCCcEEEEECCCc---EEEeCCCC---cceeEccccCC------CCcceeE-EEEcCCCceEEEeCCc
Confidence 66889988887431 11122211 26765432111 1246773 2334578999888654
No 87
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=73.23 E-value=1.7e+02 Score=33.29 Aligned_cols=50 Identities=14% Similarity=0.064 Sum_probs=29.6
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPC 138 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~ 138 (526)
+-.+|+-.++++---...|-..-...+.-+||.++++|+.+ .+|.+||-.
T Consensus 331 QLlVweWqsEsYVlKQQgH~~~i~~l~YSpDgq~iaTG~eD---gKVKvWn~~ 380 (893)
T KOG0291|consen 331 QLLVWEWQSESYVLKQQGHSDRITSLAYSPDGQLIATGAED---GKVKVWNTQ 380 (893)
T ss_pred eEEEEEeeccceeeeccccccceeeEEECCCCcEEEeccCC---CcEEEEecc
Confidence 34455544444332222222333345567899999999974 578888876
No 88
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=73.13 E-value=1.2e+02 Score=31.27 Aligned_cols=58 Identities=10% Similarity=0.215 Sum_probs=32.7
Q ss_pred ceEEEEeecCCCCceec-----ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEE--eCCCCcEeecC
Q 043369 315 SCGRLTITAQNPKWEME-----EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIY--CPKINRFRILS 387 (526)
Q Consensus 315 s~~~~d~~~~~~~W~~~-----~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~Y--DP~t~~Wt~~a 387 (526)
++..|++...+.+.+.. .-..||.+ .+-|||+.+++.....+ .+.+| |+++.+++.+.
T Consensus 268 sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~---~~s~~g~~l~Va~~~s~------------~v~vf~~d~~tG~l~~~~ 332 (345)
T PF10282_consen 268 SISVFDLDPATGTLTLVQTVPTGGKFPRHF---AFSPDGRYLYVANQDSN------------TVSVFDIDPDTGKLTPVG 332 (345)
T ss_dssp EEEEEEECTTTTTEEEEEEEEESSSSEEEE---EE-TTSSEEEEEETTTT------------EEEEEEEETTTTEEEEEE
T ss_pred EEEEEEEecCCCceEEEEEEeCCCCCccEE---EEeCCCCEEEEEecCCC------------eEEEEEEeCCCCcEEEec
Confidence 45567764323333321 23456753 45689998888765421 34555 77888887654
No 89
>PTZ00421 coronin; Provisional
Probab=71.97 E-value=1.6e+02 Score=32.27 Aligned_cols=109 Identities=8% Similarity=0.057 Sum_probs=55.3
Q ss_pred CCcEEEEcCCCCCccEEEEEcCCCCCCcccc---cCCCCCc-ccccceeEEecC-CcEEEEcCccCCeEEEE-cCCCCCC
Q 043369 116 NGVLVQTGGYRLGERVVRYLKPCSDCDWEED---HQNGLIS-PRWYASNQILPN-GKIIVVGGRFQFTYEFI-PRTSDSD 189 (526)
Q Consensus 116 ~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~---~~~~m~~-~R~y~s~~~L~d-G~v~viGG~~~~~~E~y-P~~~~~~ 189 (526)
|+.++++|+.+ ..+.+||.. +...... +...+.. .+.-.+++--++ +.+++.||.++ ++.+| ..+..
T Consensus 87 d~~~LaSgS~D---gtIkIWdi~-~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~Dg-tVrIWDl~tg~-- 159 (493)
T PTZ00421 87 DPQKLFTASED---GTIMGWGIP-EEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADM-VVNVWDVERGK-- 159 (493)
T ss_pred CCCEEEEEeCC---CEEEEEecC-CCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCC-EEEEEECCCCe--
Confidence 67888888863 478888865 3321110 0011211 111112222333 36888887654 56777 44331
Q ss_pred CcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCeEE
Q 043369 190 RKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNRVM 243 (526)
Q Consensus 190 ~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~ 243 (526)
....+..- . ...+. +...++|++++.|+.+ ..+||+.+++-.
T Consensus 160 --~~~~l~~h--~-------~~V~s-la~spdG~lLatgs~Dg~IrIwD~rsg~~v 203 (493)
T PTZ00421 160 --AVEVIKCH--S-------DQITS-LEWNLDGSLLCTTSKDKKLNIIDPRDGTIV 203 (493)
T ss_pred --EEEEEcCC--C-------CceEE-EEEECCCCEEEEecCCCEEEEEECCCCcEE
Confidence 11111100 0 01111 2235689999988754 678999987644
No 90
>PTZ00421 coronin; Provisional
Probab=71.71 E-value=1.6e+02 Score=32.22 Aligned_cols=53 Identities=15% Similarity=0.061 Sum_probs=33.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCD 142 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~ 142 (526)
...+||..+++-...-..+.........-++|.++++|+.+ ..+++||+. +.+
T Consensus 149 tVrIWDl~tg~~~~~l~~h~~~V~sla~spdG~lLatgs~D---g~IrIwD~r-sg~ 201 (493)
T PTZ00421 149 VVNVWDVERGKAVEVIKCHSDQITSLEWNLDGSLLCTTSKD---KKLNIIDPR-DGT 201 (493)
T ss_pred EEEEEECCCCeEEEEEcCCCCceEEEEEECCCCEEEEecCC---CEEEEEECC-CCc
Confidence 46789988765432211122222234456799999999863 579999998 543
No 91
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=71.49 E-value=18 Score=37.60 Aligned_cols=52 Identities=15% Similarity=0.127 Sum_probs=35.6
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDC 141 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~ 141 (526)
.+.+||+.|.+=...-.-|..|--.-+--+||+.++.|-.+ .++.+|||. ++
T Consensus 138 TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~d---g~I~lwdpk-tg 189 (480)
T KOG0271|consen 138 TVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKD---GSIRLWDPK-TG 189 (480)
T ss_pred eEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccC---CeEEEecCC-CC
Confidence 57889998865222222355565545677899999988653 579999998 44
No 92
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=70.81 E-value=1.4e+02 Score=31.08 Aligned_cols=133 Identities=17% Similarity=0.234 Sum_probs=75.7
Q ss_pred eEEEEeCCCCcEEe-CccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccc-cCCCCCcccccceeEE
Q 043369 86 HAVEFDPITRKVRP-LTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEED-HQNGLISPRWYASNQI 162 (526)
Q Consensus 86 ~~~~yDp~t~~w~~-~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~-~~~~m~~~R~y~s~~~ 162 (526)
.+.+||..++.|-- ++-..+.. ....+-.||.++++|+.. -.+.+|.-.. ..+|.-. ...+|..-+|.|
T Consensus 87 ~AflW~~~~ge~~~eltgHKDSV-t~~~FshdgtlLATGdms---G~v~v~~~stg~~~~~~~~e~~dieWl~WHp---- 158 (399)
T KOG0296|consen 87 LAFLWDISTGEFAGELTGHKDSV-TCCSFSHDGTLLATGDMS---GKVLVFKVSTGGEQWKLDQEVEDIEWLKWHP---- 158 (399)
T ss_pred eEEEEEccCCcceeEecCCCCce-EEEEEccCceEEEecCCC---ccEEEEEcccCceEEEeecccCceEEEEecc----
Confidence 57889999988653 32222321 113456799999999984 3566666541 4567542 124677778865
Q ss_pred ecCCcEEEEcCccCCeEEEE--cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc--ceEEEecc
Q 043369 163 LPNGKIIVVGGRFQFTYEFI--PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND--RAILLDYV 238 (526)
Q Consensus 163 L~dG~v~viGG~~~~~~E~y--P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~--~~~~yDp~ 238 (526)
-+.|+..|-.++ ++.+| |... .-..++.-.. +.. ..-.+||||-.+.|-. ...+|||+
T Consensus 159 --~a~illAG~~DG-svWmw~ip~~~-----~~kv~~Gh~~-------~ct---~G~f~pdGKr~~tgy~dgti~~Wn~k 220 (399)
T KOG0296|consen 159 --RAHILLAGSTDG-SVWMWQIPSQA-----LCKVMSGHNS-------PCT---CGEFIPDGKRILTGYDDGTIIVWNPK 220 (399)
T ss_pred --cccEEEeecCCC-cEEEEECCCcc-----eeeEecCCCC-------Ccc---cccccCCCceEEEEecCceEEEEecC
Confidence 356777765543 45666 4422 1112221100 001 1235789988887764 35789999
Q ss_pred CCeEEE
Q 043369 239 NNRVMK 244 (526)
Q Consensus 239 t~~w~~ 244 (526)
+.+-..
T Consensus 221 tg~p~~ 226 (399)
T KOG0296|consen 221 TGQPLH 226 (399)
T ss_pred CCceeE
Confidence 986543
No 93
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=69.68 E-value=1.2e+02 Score=30.48 Aligned_cols=136 Identities=15% Similarity=0.183 Sum_probs=69.8
Q ss_pred EEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCC
Q 043369 87 AVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNG 166 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG 166 (526)
..+||.++++-+..-..|.+---+.++-+|.+-++.|-.+ +++..||....++.+.. ..+. .-|-.++.-.|+.
T Consensus 87 lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivSGSrD---kTiklwnt~g~ck~t~~--~~~~-~~WVscvrfsP~~ 160 (315)
T KOG0279|consen 87 LRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVSGSRD---KTIKLWNTLGVCKYTIH--EDSH-REWVSCVRFSPNE 160 (315)
T ss_pred EEEEEecCCcEEEEEEecCCceEEEEecCCCceeecCCCc---ceeeeeeecccEEEEEe--cCCC-cCcEEEEEEcCCC
Confidence 4556666654333322221111123455688888877543 67788887622333332 2343 3454455555552
Q ss_pred -cEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccceE--EEeccCCe
Q 043369 167 -KIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAI--LLDYVNNR 241 (526)
Q Consensus 167 -~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~--~yDp~t~~ 241 (526)
..+|+.+.+.+++.+|...+- +-. ..++-. ..+-..+.+.|||.+.+.||.+.+ ++|....+
T Consensus 161 ~~p~Ivs~s~DktvKvWnl~~~----~l~-~~~~gh--------~~~v~t~~vSpDGslcasGgkdg~~~LwdL~~~k 225 (315)
T KOG0279|consen 161 SNPIIVSASWDKTVKVWNLRNC----QLR-TTFIGH--------SGYVNTVTVSPDGSLCASGGKDGEAMLWDLNEGK 225 (315)
T ss_pred CCcEEEEccCCceEEEEccCCc----chh-hccccc--------cccEEEEEECCCCCEEecCCCCceEEEEEccCCc
Confidence 455555555567777732220 100 001101 111123467789999999998765 55665544
No 94
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=68.65 E-value=1.7e+02 Score=31.34 Aligned_cols=112 Identities=14% Similarity=0.185 Sum_probs=58.2
Q ss_pred cCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccc-cceeEEecCCc-EEEEcCccCCeEEEE-cCCCCCCC
Q 043369 114 LANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRW-YASNQILPNGK-IIVVGGRFQFTYEFI-PRTSDSDR 190 (526)
Q Consensus 114 l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~-y~s~~~L~dG~-v~viGG~~~~~~E~y-P~~~~~~~ 190 (526)
-+.-.+++++|.+ +.+++|--. ...=..+ .+|...+. -.+++-.++|. +.+.+|+... +-.| -.+.
T Consensus 222 Hp~~plllvaG~d---~~lrifqvD-Gk~N~~l--qS~~l~~fPi~~a~f~p~G~~~i~~s~rrky-~ysyDle~a---- 290 (514)
T KOG2055|consen 222 HPTAPLLLVAGLD---GTLRIFQVD-GKVNPKL--QSIHLEKFPIQKAEFAPNGHSVIFTSGRRKY-LYSYDLETA---- 290 (514)
T ss_pred cCCCceEEEecCC---CcEEEEEec-CccChhh--eeeeeccCccceeeecCCCceEEEecccceE-EEEeecccc----
Confidence 3466788888884 466777554 2222233 24444443 23556667888 8888887643 2223 2221
Q ss_pred cceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEE--EeccCCeEE
Q 043369 191 KILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAIL--LDYVNNRVM 243 (526)
Q Consensus 191 ~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~--yDp~t~~w~ 243 (526)
+-..+..+... +....-.--+.+++++.++.|+..++ ...+|+.|.
T Consensus 291 -k~~k~~~~~g~------e~~~~e~FeVShd~~fia~~G~~G~I~lLhakT~eli 338 (514)
T KOG2055|consen 291 -KVTKLKPPYGV------EEKSMERFEVSHDSNFIAIAGNNGHIHLLHAKTKELI 338 (514)
T ss_pred -ccccccCCCCc------ccchhheeEecCCCCeEEEcccCceEEeehhhhhhhh
Confidence 22222111100 00000012356788888888877654 456677765
No 95
>PTZ00420 coronin; Provisional
Probab=68.46 E-value=1.6e+02 Score=32.80 Aligned_cols=135 Identities=9% Similarity=0.070 Sum_probs=66.2
Q ss_pred eEEEEeCCCCcEE-eCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccc-cceeE-E
Q 043369 86 HAVEFDPITRKVR-PLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRW-YASNQ-I 162 (526)
Q Consensus 86 ~~~~yDp~t~~w~-~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~-y~s~~-~ 162 (526)
...+||..+++-. .+. .+.. ......-++|.++++++.. +.+++||+. +.+= . ..+..... ..+.+ -
T Consensus 149 tIrIWDl~tg~~~~~i~-~~~~-V~SlswspdG~lLat~s~D---~~IrIwD~R-sg~~--i--~tl~gH~g~~~s~~v~ 218 (568)
T PTZ00420 149 FVNIWDIENEKRAFQIN-MPKK-LSSLKWNIKGNLLSGTCVG---KHMHIIDPR-KQEI--A--SSFHIHDGGKNTKNIW 218 (568)
T ss_pred eEEEEECCCCcEEEEEe-cCCc-EEEEEECCCCCEEEEEecC---CEEEEEECC-CCcE--E--EEEecccCCceeEEEE
Confidence 4668898776522 121 1121 2234456799999988753 579999998 5421 1 11111100 00111 1
Q ss_pred e----cCCcEEEEcCccC---CeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEc--cce
Q 043369 163 L----PNGKIIVVGGRFQ---FTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAN--DRA 232 (526)
Q Consensus 163 L----~dG~v~viGG~~~---~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg--~~~ 232 (526)
+ +|+..++.+|.+. ..+-+| .+.. ...... ...+. ....+.|+. --.+|.+|+.|. ...
T Consensus 219 ~~~fs~d~~~IlTtG~d~~~~R~VkLWDlr~~----~~pl~~----~~ld~--~~~~L~p~~-D~~tg~l~lsGkGD~tI 287 (568)
T PTZ00420 219 IDGLGGDDNYILSTGFSKNNMREMKLWDLKNT----TSALVT----MSIDN--ASAPLIPHY-DESTGLIYLIGKGDGNC 287 (568)
T ss_pred eeeEcCCCCEEEEEEcCCCCccEEEEEECCCC----CCceEE----EEecC--CccceEEee-eCCCCCEEEEEECCCeE
Confidence 1 4667777766553 357777 4421 011110 01110 011122221 133689998884 346
Q ss_pred EEEeccCCe
Q 043369 233 ILLDYVNNR 241 (526)
Q Consensus 233 ~~yDp~t~~ 241 (526)
.+|+...+.
T Consensus 288 r~~e~~~~~ 296 (568)
T PTZ00420 288 RYYQHSLGS 296 (568)
T ss_pred EEEEccCCc
Confidence 778877654
No 96
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=66.85 E-value=1.2e+02 Score=32.41 Aligned_cols=133 Identities=11% Similarity=0.028 Sum_probs=71.0
Q ss_pred ceEEEEeCCCCcEEeCccCC---ccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeE
Q 043369 85 AHAVEFDPITRKVRPLTIQT---DTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQ 161 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~~~~~---~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~ 161 (526)
.....||..+.+.+++..+. ..+-.--.+-+++..+++-|.. -.+.+.... +..|... -.|+ ++ -...+
T Consensus 280 ky~ysyDle~ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~---G~I~lLhak-T~eli~s--~Kie-G~-v~~~~ 351 (514)
T KOG2055|consen 280 KYLYSYDLETAKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAGNN---GHIHLLHAK-TKELITS--FKIE-GV-VSDFT 351 (514)
T ss_pred eEEEEeeccccccccccCCCCcccchhheeEecCCCCeEEEcccC---ceEEeehhh-hhhhhhe--eeec-cE-EeeEE
Confidence 35678999999998876542 2222222344677777777763 356677777 8888654 2333 22 12233
Q ss_pred EecCCcEEEEcCccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEecc
Q 043369 162 ILPNGKIIVVGGRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYV 238 (526)
Q Consensus 162 ~L~dG~v~viGG~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~ 238 (526)
--+||+.+++-|..+ .+.+| -..+. ...+|..-..+. .-..+..++|..|+.|... +-+||..
T Consensus 352 fsSdsk~l~~~~~~G-eV~v~nl~~~~-~~~rf~D~G~v~------------gts~~~S~ng~ylA~GS~~GiVNIYd~~ 417 (514)
T KOG2055|consen 352 FSSDSKELLASGGTG-EVYVWNLRQNS-CLHRFVDDGSVH------------GTSLCISLNGSYLATGSDSGIVNIYDGN 417 (514)
T ss_pred EecCCcEEEEEcCCc-eEEEEecCCcc-eEEEEeecCccc------------eeeeeecCCCceEEeccCcceEEEeccc
Confidence 336776655554433 23333 22220 001222111111 1123345799988888765 5688876
Q ss_pred C
Q 043369 239 N 239 (526)
Q Consensus 239 t 239 (526)
+
T Consensus 418 s 418 (514)
T KOG2055|consen 418 S 418 (514)
T ss_pred h
Confidence 4
No 97
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=62.19 E-value=1.5e+02 Score=31.48 Aligned_cols=121 Identities=15% Similarity=0.174 Sum_probs=67.6
Q ss_pred cceEEEecCCcEEEEEccc--eEEEeccCCeEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEE
Q 043369 213 YPFLHLSTDGNLFIFANDR--AILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVL 290 (526)
Q Consensus 213 yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~ 290 (526)
|..+..-|||.||..|-.+ ..+||.+...-. ...|+. +|...-+... .+|--+
T Consensus 350 ~ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~---a~Fpgh-------t~~vk~i~Fs---------------ENGY~L 404 (506)
T KOG0289|consen 350 YTSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNV---AKFPGH-------TGPVKAISFS---------------ENGYWL 404 (506)
T ss_pred eEEeeEcCCceEEeccCCCceEEEEEcCCcccc---ccCCCC-------CCceeEEEec---------------cCceEE
Confidence 5556677899999988654 467888876532 222321 1211111111 245555
Q ss_pred EEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceecccCccccccceEEe-CCCcEEEEcCcCCCCCCccCCCCC
Q 043369 291 ICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEMEEMPLNRVMGDMILL-PTGDVLIINGAAKGTAGWGAAREP 369 (526)
Q Consensus 291 v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~R~~~~~vvL-pdG~V~vvGG~~~g~~g~~~~~~~ 369 (526)
+.+-.+ .++.++|++.- .....-.++... ...++.+ +.|+.++++|.+
T Consensus 405 at~add-----------------~~V~lwDLRKl-~n~kt~~l~~~~-~v~s~~fD~SGt~L~~~g~~------------ 453 (506)
T KOG0289|consen 405 ATAADD-----------------GSVKLWDLRKL-KNFKTIQLDEKK-EVNSLSFDQSGTYLGIAGSD------------ 453 (506)
T ss_pred EEEecC-----------------CeEEEEEehhh-cccceeeccccc-cceeEEEcCCCCeEEeecce------------
Confidence 554322 13678888741 222222333322 1233332 458999988754
Q ss_pred ccccEEEeCCCCcEeecCCCC
Q 043369 370 VLNPVIYCPKINRFRILSPSL 390 (526)
Q Consensus 370 ~~~~e~YDP~t~~Wt~~a~~~ 390 (526)
.++.+|+-.+.+|+.+...+
T Consensus 454 -l~Vy~~~k~~k~W~~~~~~~ 473 (506)
T KOG0289|consen 454 -LQVYICKKKTKSWTEIKELA 473 (506)
T ss_pred -eEEEEEecccccceeeehhh
Confidence 36889999999999876654
No 98
>PRK04792 tolB translocation protein TolB; Provisional
Probab=61.42 E-value=1.5e+02 Score=31.74 Aligned_cols=91 Identities=11% Similarity=0.091 Sum_probs=54.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
...++|..+++.+++..... ........+||+.+++....++...+..+|.. +.++..+ . ....++.+.+.-+|
T Consensus 287 ~Iy~~dl~tg~~~~lt~~~~-~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~-~g~~~~L--t--~~g~~~~~~~~SpD 360 (448)
T PRK04792 287 EIYVVDIATKALTRITRHRA-IDTEPSWHPDGKSLIFTSERGGKPQIYRVNLA-SGKVSRL--T--FEGEQNLGGSITPD 360 (448)
T ss_pred EEEEEECCCCCeEECccCCC-CccceEECCCCCEEEEEECCCCCceEEEEECC-CCCEEEE--e--cCCCCCcCeeECCC
Confidence 46678999998888764321 12234556798876665443455678888987 7777655 1 12233333445568
Q ss_pred CcEEEEcCccCCeEEEE
Q 043369 166 GKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 166 G~v~viGG~~~~~~E~y 182 (526)
|+.++..........+|
T Consensus 361 G~~l~~~~~~~g~~~I~ 377 (448)
T PRK04792 361 GRSMIMVNRTNGKFNIA 377 (448)
T ss_pred CCEEEEEEecCCceEEE
Confidence 87777655443334443
No 99
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=60.78 E-value=71 Score=32.22 Aligned_cols=96 Identities=10% Similarity=0.148 Sum_probs=57.2
Q ss_pred CCcEEEcccCCccce-eEEEE-ecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCC
Q 043369 27 EGKWKLLKRSIGVSA-MHMAL-LPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQT 104 (526)
Q Consensus 27 ~g~W~~~~~~~~v~~-~~~a~-l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~ 104 (526)
..+|..+... +.. ++... ..+++||+-|....+ +. .......||.++++|+.+....
T Consensus 25 ~~qW~~~g~~--i~G~V~~l~~~~~~~Llv~G~ft~~--------~~-----------~~~~la~yd~~~~~w~~~~~~~ 83 (281)
T PF12768_consen 25 NSQWSSPGNG--ISGTVTDLQWASNNQLLVGGNFTLN--------GT-----------NSSNLATYDFKNQTWSSLGGGS 83 (281)
T ss_pred CCEeecCCCC--ceEEEEEEEEecCCEEEEEEeeEEC--------CC-----------CceeEEEEecCCCeeeecCCcc
Confidence 5899997532 432 23222 347777777754321 10 1245788999999999887632
Q ss_pred -----ccccccceEcCCC-cEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 105 -----DTWCSSGALLANG-VLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 105 -----~~fc~~~~~l~~G-~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
...-+......|+ ++++.|....+...+..|| ..+|...
T Consensus 84 s~~ipgpv~a~~~~~~d~~~~~~aG~~~~g~~~l~~~d---Gs~W~~i 128 (281)
T PF12768_consen 84 SNSIPGPVTALTFISNDGSNFWVAGRSANGSTFLMKYD---GSSWSSI 128 (281)
T ss_pred cccCCCcEEEEEeeccCCceEEEeceecCCCceEEEEc---CCceEec
Confidence 2221111222244 5777776655667788887 6689887
No 100
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=60.69 E-value=12 Score=38.82 Aligned_cols=57 Identities=16% Similarity=0.180 Sum_probs=37.2
Q ss_pred eCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCCC
Q 043369 345 LPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 345 LpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
-|+|+.++.|+.+. ++-+||+.|.+ .+..+.--+....+...-|||+.++.|+-.+.
T Consensus 124 sp~g~~l~tGsGD~-------------TvR~WD~~TeT--p~~t~KgH~~WVlcvawsPDgk~iASG~~dg~ 180 (480)
T KOG0271|consen 124 SPTGSRLVTGSGDT-------------TVRLWDLDTET--PLFTCKGHKNWVLCVAWSPDGKKIASGSKDGS 180 (480)
T ss_pred cCCCceEEecCCCc-------------eEEeeccCCCC--cceeecCCccEEEEEEECCCcchhhccccCCe
Confidence 47999999987542 67899999872 11122222223334455799999999986543
No 101
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=60.16 E-value=2.1e+02 Score=31.17 Aligned_cols=26 Identities=19% Similarity=0.374 Sum_probs=17.7
Q ss_pred EecCCcEEEEEc-cceEEEeccCCe--EE
Q 043369 218 LSTDGNLFIFAN-DRAILLDYVNNR--VM 243 (526)
Q Consensus 218 ~~~dG~Iy~~Gg-~~~~~yDp~t~~--w~ 243 (526)
++.+|+||+... .....+|.++++ |.
T Consensus 58 vv~~g~vy~~~~~g~l~AlD~~tG~~~W~ 86 (488)
T cd00216 58 LVVDGDMYFTTSHSALFALDAATGKVLWR 86 (488)
T ss_pred EEECCEEEEeCCCCcEEEEECCCChhhce
Confidence 455889988654 346778988765 65
No 102
>PLN00181 protein SPA1-RELATED; Provisional
Probab=57.74 E-value=3.6e+02 Score=31.30 Aligned_cols=103 Identities=11% Similarity=0.071 Sum_probs=53.2
Q ss_pred CCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCccccc-ceeEEe-cCCcEEEEcCccCCeEEEE-cCCCCCCCcc
Q 043369 116 NGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWY-ASNQIL-PNGKIIVVGGRFQFTYEFI-PRTSDSDRKI 192 (526)
Q Consensus 116 ~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y-~s~~~L-~dG~v~viGG~~~~~~E~y-P~~~~~~~~~ 192 (526)
++..+++|+.+ ..+++||.. +.+-.. .+....-. .+++.- .++.+++.||.++ .+.+| ..+.. .
T Consensus 544 ~~~~las~~~D---g~v~lWd~~-~~~~~~----~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg-~v~iWd~~~~~----~ 610 (793)
T PLN00181 544 IKSQVASSNFE---GVVQVWDVA-RSQLVT----EMKEHEKRVWSIDYSSADPTLLASGSDDG-SVKLWSINQGV----S 610 (793)
T ss_pred CCCEEEEEeCC---CeEEEEECC-CCeEEE----EecCCCCCEEEEEEcCCCCCEEEEEcCCC-EEEEEECCCCc----E
Confidence 46778888763 578999976 443221 12111111 122222 3788999998764 56677 43321 1
Q ss_pred eeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCe
Q 043369 193 LYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNR 241 (526)
Q Consensus 193 w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~ 241 (526)
...+. .. .......+...+|+++++|+.+ ..+||..+.+
T Consensus 611 ~~~~~---~~-------~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~ 651 (793)
T PLN00181 611 IGTIK---TK-------ANICCVQFPSESGRSLAFGSADHKVYYYDLRNPK 651 (793)
T ss_pred EEEEe---cC-------CCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCC
Confidence 11111 00 0111112223478899888754 5678876543
No 103
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=54.09 E-value=2.6e+02 Score=28.54 Aligned_cols=241 Identities=11% Similarity=0.116 Sum_probs=96.5
Q ss_pred CCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcc-cccceeEEecCCcEEEEc
Q 043369 94 TRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISP-RWYASNQILPNGKIIVVG 172 (526)
Q Consensus 94 t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~-R~y~s~~~L~dG~v~viG 172 (526)
.+.|+.+....+.-.....++-+..-+++|-.. .-.+.-|= ..+|... ..+...+ ......+...+.+.||+|
T Consensus 5 ~~~W~~v~l~t~~~l~dV~F~d~~~G~~VG~~g---~il~T~DG--G~tW~~~-~~~~~~~~~~~l~~I~f~~~~g~ivG 78 (302)
T PF14870_consen 5 GNSWQQVSLPTDKPLLDVAFVDPNHGWAVGAYG---TILKTTDG--GKTWQPV-SLDLDNPFDYHLNSISFDGNEGWIVG 78 (302)
T ss_dssp S--EEEEE-S-SS-EEEEEESSSS-EEEEETTT---EEEEESST--TSS-EE------S-----EEEEEEEETTEEEEEE
T ss_pred CCCcEEeecCCCCceEEEEEecCCEEEEEecCC---EEEEECCC--Ccccccc-ccCCCccceeeEEEEEecCCceEEEc
Confidence 457877765554433334455457778887542 12222232 5689876 2233333 222334444578899887
Q ss_pred CccCCeEEEE-cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEecc--CCeEEEeccCC
Q 043369 173 GRFQFTYEFI-PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDYV--NNRVMKNYPVM 249 (526)
Q Consensus 173 G~~~~~~E~y-P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp~--t~~w~~~~p~~ 249 (526)
-.. . ++ ...+. .+|..++.... . +...+ ....+.++.+.+++.. ..+|-.. -.+|.......
T Consensus 79 ~~g---~-ll~T~DgG---~tW~~v~l~~~-l-----pgs~~-~i~~l~~~~~~l~~~~-G~iy~T~DgG~tW~~~~~~~ 143 (302)
T PF14870_consen 79 EPG---L-LLHTTDGG---KTWERVPLSSK-L-----PGSPF-GITALGDGSAELAGDR-GAIYRTTDGGKTWQAVVSET 143 (302)
T ss_dssp ETT---E-EEEESSTT---SS-EE----TT-------SS-EE-EEEEEETTEEEEEETT---EEEESSTTSSEEEEE-S-
T ss_pred CCc---e-EEEecCCC---CCcEEeecCCC-C-----CCCee-EEEEcCCCcEEEEcCC-CcEEEeCCCCCCeeEcccCC
Confidence 421 1 33 22221 37876543111 1 11112 1234456677776654 3344433 24787322111
Q ss_pred CCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCce
Q 043369 250 PGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWE 329 (526)
Q Consensus 250 p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~ 329 (526)
. |+.. -+. ...+|++++++-.. .. ....|+. ...|+
T Consensus 144 ~----------gs~~--~~~-------------r~~dG~~vavs~~G--~~---------------~~s~~~G--~~~w~ 179 (302)
T PF14870_consen 144 S----------GSIN--DIT-------------RSSDGRYVAVSSRG--NF---------------YSSWDPG--QTTWQ 179 (302)
T ss_dssp -------------EE--EEE-------------E-TTS-EEEEETTS--SE---------------EEEE-TT---SS-E
T ss_pred c----------ceeE--eEE-------------ECCCCcEEEEECcc--cE---------------EEEecCC--Cccce
Confidence 1 1110 000 01378888887542 11 0123432 35698
Q ss_pred ecccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEe-C-CCCcEeecCCCCccccccc--cceecCCC
Q 043369 330 MEEMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYC-P-KINRFRILSPSLIPRLYHS--TAHLLSDG 405 (526)
Q Consensus 330 ~~~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YD-P-~t~~Wt~~a~~~~~R~yhs--~a~LlpdG 405 (526)
.-..+..|..-++..-+|+.++++. + |. .+..=| + ..++|++-. .++...+++ .....+++
T Consensus 180 ~~~r~~~~riq~~gf~~~~~lw~~~--~-Gg-----------~~~~s~~~~~~~~w~~~~-~~~~~~~~~~ld~a~~~~~ 244 (302)
T PF14870_consen 180 PHNRNSSRRIQSMGFSPDGNLWMLA--R-GG-----------QIQFSDDPDDGETWSEPI-IPIKTNGYGILDLAYRPPN 244 (302)
T ss_dssp EEE--SSS-EEEEEE-TTS-EEEEE--T-TT-----------EEEEEE-TTEEEEE---B--TTSS--S-EEEEEESSSS
T ss_pred EEccCccceehhceecCCCCEEEEe--C-Cc-----------EEEEccCCCCcccccccc-CCcccCceeeEEEEecCCC
Confidence 8766666665666667999998865 1 21 011111 1 223677622 222222222 22345789
Q ss_pred EEEEecCCC
Q 043369 406 RVLVGGSNP 414 (526)
Q Consensus 406 ~V~v~GG~~ 414 (526)
.|+++||.-
T Consensus 245 ~~wa~gg~G 253 (302)
T PF14870_consen 245 EIWAVGGSG 253 (302)
T ss_dssp -EEEEESTT
T ss_pred CEEEEeCCc
Confidence 999999964
No 104
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=51.86 E-value=1.6e+02 Score=31.49 Aligned_cols=143 Identities=14% Similarity=0.066 Sum_probs=73.3
Q ss_pred eEEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCc-cCCccccccceEcC--CCc
Q 043369 42 MHMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLT-IQTDTWCSSGALLA--NGV 118 (526)
Q Consensus 42 ~~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~-~~~~~fc~~~~~l~--~G~ 118 (526)
+.+|+-+|||+++.|+.+ .+..+||..|.+-...- ...+... +.++- -..
T Consensus 206 l~~avS~Dgkylatgg~d-------------------------~~v~Iw~~~t~ehv~~~~ghr~~V~--~L~fr~gt~~ 258 (479)
T KOG0299|consen 206 LTLAVSSDGKYLATGGRD-------------------------RHVQIWDCDTLEHVKVFKGHRGAVS--SLAFRKGTSE 258 (479)
T ss_pred EEEEEcCCCcEEEecCCC-------------------------ceEEEecCcccchhhccccccccee--eeeeecCccc
Confidence 456677899999998864 14678998776544331 1111111 11111 234
Q ss_pred EEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEEE--cCCCCCCCcceeec
Q 043369 119 LVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFI--PRTSDSDRKILYQL 196 (526)
Q Consensus 119 l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~y--P~~~~~~~~~w~~~ 196 (526)
+|..+= .+++.+|+-. .....+. ---.+-.-.+.-+|.-+|+..+||++. ++.+| |... +-...
T Consensus 259 lys~s~----Drsvkvw~~~-~~s~vet---lyGHqd~v~~IdaL~reR~vtVGgrDr-T~rlwKi~ees-----qlifr 324 (479)
T KOG0299|consen 259 LYSASA----DRSVKVWSID-QLSYVET---LYGHQDGVLGIDALSRERCVTVGGRDR-TVRLWKIPEES-----QLIFR 324 (479)
T ss_pred eeeeec----CCceEEEehh-HhHHHHH---HhCCccceeeechhcccceEEeccccc-eeEEEeccccc-----eeeee
Confidence 444332 1456666655 3333321 011111123344566789999999985 45566 3321 11111
Q ss_pred CCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEec
Q 043369 197 PFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDY 237 (526)
Q Consensus 197 p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp 237 (526)
+. .-.+-++.+.|..=|+.|.....++=+
T Consensus 325 g~------------~~sidcv~~In~~HfvsGSdnG~IaLW 353 (479)
T KOG0299|consen 325 GG------------EGSIDCVAFINDEHFVSGSDNGSIALW 353 (479)
T ss_pred CC------------CCCeeeEEEecccceeeccCCceEEEe
Confidence 10 011234566677778888776655433
No 105
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=50.57 E-value=2.5e+02 Score=29.03 Aligned_cols=79 Identities=18% Similarity=0.262 Sum_probs=45.9
Q ss_pred eEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC--cEeecCCC-Cc
Q 043369 316 CGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN--RFRILSPS-LI 391 (526)
Q Consensus 316 ~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~--~Wt~~a~~-~~ 391 (526)
..++|..+....|+.. +.. .+.... .+..|+.||+.... + .+.+.|+++. +|+.-.+. ..
T Consensus 123 ~y~ld~~~G~~~W~~~~~~~-~~~~~~-~v~~~~~v~~~s~~--g------------~~~al~~~tG~~~W~~~~~~~~~ 186 (370)
T COG1520 123 LYALDASTGTLVWSRNVGGS-PYYASP-PVVGDGTVYVGTDD--G------------HLYALNADTGTLKWTYETPAPLS 186 (370)
T ss_pred EEEEECCCCcEEEEEecCCC-eEEecC-cEEcCcEEEEecCC--C------------eEEEEEccCCcEEEEEecCCccc
Confidence 5678875446779874 442 444444 44459999987521 1 3466777766 68743332 23
Q ss_pred cccccccceecCCCEEEEecC
Q 043369 392 PRLYHSTAHLLSDGRVLVGGS 412 (526)
Q Consensus 392 ~R~yhs~a~LlpdG~V~v~GG 412 (526)
.+.+-+.+ .-+|.||+..-
T Consensus 187 ~~~~~~~~--~~~~~vy~~~~ 205 (370)
T COG1520 187 LSIYGSPA--IASGTVYVGSD 205 (370)
T ss_pred cccccCce--eecceEEEecC
Confidence 33333333 45888888755
No 106
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=49.42 E-value=1.8e+02 Score=32.05 Aligned_cols=60 Identities=15% Similarity=0.126 Sum_probs=32.2
Q ss_pred eEEEEeecCCCCceec--ccCccccccceEEeCCCcEEEEcCcC-CCCCCccCCCCCccccEEEeCCCC--cEe
Q 043369 316 CGRLTITAQNPKWEME--EMPLNRVMGDMILLPTGDVLIINGAA-KGTAGWGAAREPVLNPVIYCPKIN--RFR 384 (526)
Q Consensus 316 ~~~~d~~~~~~~W~~~--~M~~~R~~~~~vvLpdG~V~vvGG~~-~g~~g~~~~~~~~~~~e~YDP~t~--~Wt 384 (526)
+.++|..+....|+.. .+.......++-++.+|+||+-.... .+ .--.+..||.++. .|+
T Consensus 132 l~ALDa~TGk~~W~~~~~~~~~~~~~tssP~v~~g~Vivg~~~~~~~---------~~G~v~AlD~~TG~~lW~ 196 (527)
T TIGR03075 132 LVALDAKTGKVVWSKKNGDYKAGYTITAAPLVVKGKVITGISGGEFG---------VRGYVTAYDAKTGKLVWR 196 (527)
T ss_pred EEEEECCCCCEEeecccccccccccccCCcEEECCEEEEeecccccC---------CCcEEEEEECCCCceeEe
Confidence 4578876656679864 33222122233344588887753211 11 1114677888888 465
No 107
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=48.67 E-value=3.7e+02 Score=28.86 Aligned_cols=233 Identities=14% Similarity=0.151 Sum_probs=120.3
Q ss_pred eEcCCCcEEEEcCCCCCccEEEEEcCCCCCCc-ccccCCCC-CcccccceeEEecCCcEEEEcCccCCeEEEE-cCCCCC
Q 043369 112 ALLANGVLVQTGGYRLGERVVRYLKPCSDCDW-EEDHQNGL-ISPRWYASNQILPNGKIIVVGGRFQFTYEFI-PRTSDS 188 (526)
Q Consensus 112 ~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W-~~~~~~~m-~~~R~y~s~~~L~dG~v~viGG~~~~~~E~y-P~~~~~ 188 (526)
.+-+||+.++.+... +.+.+++.. + .+ ... ..+ ...++-...+--+||+ |++.|.+..++.+| ...+.
T Consensus 166 ~fs~~g~~l~~~~~~---~~i~~~~~~-~-~~~~~~--~~l~~h~~~v~~~~fs~d~~-~l~s~s~D~tiriwd~~~~~- 236 (456)
T KOG0266|consen 166 DFSPDGRALAAASSD---GLIRIWKLE-G-IKSNLL--RELSGHTRGVSDVAFSPDGS-YLLSGSDDKTLRIWDLKDDG- 236 (456)
T ss_pred EEcCCCCeEEEccCC---CcEEEeecc-c-ccchhh--ccccccccceeeeEECCCCc-EEEEecCCceEEEeeccCCC-
Confidence 346789997776542 556666664 2 23 222 223 2233334455556888 55666666678888 42220
Q ss_pred CCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCeEEEeccCCCCCCCCccCCCCc-eee
Q 043369 189 DRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNRVMKNYPVMPGGISRNYPSTGS-SVL 265 (526)
Q Consensus 189 ~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~-~v~ 265 (526)
..-..+... + ...|. +.-.++|++++.|+.+ +-+||.++.+-.+.+ +.. . .+. ++.
T Consensus 237 --~~~~~l~gH--~-------~~v~~-~~f~p~g~~i~Sgs~D~tvriWd~~~~~~~~~l---~~h---s---~~is~~~ 295 (456)
T KOG0266|consen 237 --RNLKTLKGH--S-------TYVTS-VAFSPDGNLLVSGSDDGTVRIWDVRTGECVRKL---KGH---S---DGISGLA 295 (456)
T ss_pred --eEEEEecCC--C-------CceEE-EEecCCCCEEEEecCCCcEEEEeccCCeEEEee---ecc---C---CceEEEE
Confidence 011112110 0 11122 2335578999998854 678999987654333 332 1 111 221
Q ss_pred cccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCC-cee-cccCccccccceE
Q 043369 266 LPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPK-WEM-EEMPLNRVMGDMI 343 (526)
Q Consensus 266 lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~-W~~-~~M~~~R~~~~~v 343 (526)
.+ -++.+++.+..+ ..+..+|....... -.. .....+. ....+
T Consensus 296 f~-----------------~d~~~l~s~s~d-----------------~~i~vwd~~~~~~~~~~~~~~~~~~~-~~~~~ 340 (456)
T KOG0266|consen 296 FS-----------------PDGNLLVSASYD-----------------GTIRVWDLETGSKLCLKLLSGAENSA-PVTSV 340 (456)
T ss_pred EC-----------------CCCCEEEEcCCC-----------------ccEEEEECCCCceeeeecccCCCCCC-ceeEE
Confidence 11 378888888543 13556776421100 001 1222221 22233
Q ss_pred E-eCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC----cEeecCCCCccccccccceecCCCEEEEecCCCCCCC
Q 043369 344 L-LPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN----RFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPNVNY 418 (526)
Q Consensus 344 v-LpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~----~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~~~~ 418 (526)
. -|||+.++++..+. .+-+||.... .|+..... .|...+ .+..++|+.++.|+...
T Consensus 341 ~fsp~~~~ll~~~~d~-------------~~~~w~l~~~~~~~~~~~~~~~--~~~~~~-~~~~~~~~~i~sg~~d~--- 401 (456)
T KOG0266|consen 341 QFSPNGKYLLSASLDR-------------TLKLWDLRSGKSVGTYTGHSNL--VRCIFS-PTLSTGGKLIYSGSEDG--- 401 (456)
T ss_pred EECCCCcEEEEecCCC-------------eEEEEEccCCcceeeecccCCc--ceeEec-ccccCCCCeEEEEeCCc---
Confidence 3 38999888876542 3456666655 34333332 134333 34467999999999643
Q ss_pred CcCCCCCCceeeEEEcCccc
Q 043369 419 NFSALFPTELSLQAFYPPYF 438 (526)
Q Consensus 419 ~~~~~~p~~~~vE~y~Ppyl 438 (526)
.|++|++...
T Consensus 402 ----------~v~~~~~~s~ 411 (456)
T KOG0266|consen 402 ----------SVYVWDSSSG 411 (456)
T ss_pred ----------eEEEEeCCcc
Confidence 4677777764
No 108
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=47.27 E-value=3.2e+02 Score=27.72 Aligned_cols=240 Identities=16% Similarity=0.157 Sum_probs=120.2
Q ss_pred cCCeEEEEecccCC-CCCccCCCC---ccccCcc-----ccCCCCcceEEEEeCCCCcEE---eCc---cCCccccccce
Q 043369 48 PNDRIIAFDRSHFG-PSNITLPQG---KCIKGVE-----LETSDCYAHAVEFDPITRKVR---PLT---IQTDTWCSSGA 112 (526)
Q Consensus 48 ~~gkv~~~gg~~~~-~~~~~~~~g---~~~~~~~-----~~~~~~~~~~~~yDp~t~~w~---~~~---~~~~~fc~~~~ 112 (526)
-|||++||+....+ ..-|++|.- .|..-+. .+..| ....+|+..+..-+ ++. ..+..+-+..-
T Consensus 75 qDGklIvWDs~TtnK~haipl~s~WVMtCA~sPSg~~VAcGGLd--N~Csiy~ls~~d~~g~~~v~r~l~gHtgylScC~ 152 (343)
T KOG0286|consen 75 QDGKLIVWDSFTTNKVHAIPLPSSWVMTCAYSPSGNFVACGGLD--NKCSIYPLSTRDAEGNVRVSRELAGHTGYLSCCR 152 (343)
T ss_pred cCCeEEEEEcccccceeEEecCceeEEEEEECCCCCeEEecCcC--ceeEEEecccccccccceeeeeecCccceeEEEE
Confidence 49999999987643 233444422 1322111 23444 35678888765322 111 23444545556
Q ss_pred EcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc---cCCCCCcccccceeEEec-CCcEEEEcCccCCeEEEE-cCCCC
Q 043369 113 LLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED---HQNGLISPRWYASNQILP-NGKIIVVGGRFQFTYEFI-PRTSD 187 (526)
Q Consensus 113 ~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~---~~~~m~~~R~y~s~~~L~-dG~v~viGG~~~~~~E~y-P~~~~ 187 (526)
++.|+.|+..-|. .++-.+|-. +.+=+.. |..+ -.+....+ +++.||.||.+.. ..+| -+...
T Consensus 153 f~dD~~ilT~SGD----~TCalWDie-~g~~~~~f~GH~gD------V~slsl~p~~~ntFvSg~cD~~-aklWD~R~~~ 220 (343)
T KOG0286|consen 153 FLDDNHILTGSGD----MTCALWDIE-TGQQTQVFHGHTGD------VMSLSLSPSDGNTFVSGGCDKS-AKLWDVRSGQ 220 (343)
T ss_pred EcCCCceEecCCC----ceEEEEEcc-cceEEEEecCCccc------EEEEecCCCCCCeEEecccccc-eeeeeccCcc
Confidence 7778888776664 456666665 3322111 0001 12233334 8999999998752 2233 22210
Q ss_pred CCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccc--eEEEeccCCeEEEeccCCCCCCCCccCCCCceee
Q 043369 188 SDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDR--AILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVL 265 (526)
Q Consensus 188 ~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~--~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~ 265 (526)
--...+. ...| .| .+.-.|+|.-|+.|..+ +.+||...++....+. +. .-..| -.++.
T Consensus 221 ----c~qtF~g--hesD-----IN---sv~ffP~G~afatGSDD~tcRlyDlRaD~~~a~ys--~~--~~~~g--itSv~ 280 (343)
T KOG0286|consen 221 ----CVQTFEG--HESD-----IN---SVRFFPSGDAFATGSDDATCRLYDLRADQELAVYS--HD--SIICG--ITSVA 280 (343)
T ss_pred ----eeEeecc--cccc-----cc---eEEEccCCCeeeecCCCceeEEEeecCCcEEeeec--cC--cccCC--ceeEE
Confidence 0001111 1111 11 12235689999888754 6889999987542222 11 11221 12232
Q ss_pred cccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceecccCccccccceEEe
Q 043369 266 LPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEMEEMPLNRVMGDMILL 345 (526)
Q Consensus 266 lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~~M~~~R~~~~~vvL 345 (526)
+ ...|++|.+|..+ .+|+.+|.-. ...-....=...|...- -+-
T Consensus 281 F-----------------S~SGRlLfagy~d-----------------~~c~vWDtlk-~e~vg~L~GHeNRvScl-~~s 324 (343)
T KOG0286|consen 281 F-----------------SKSGRLLFAGYDD-----------------FTCNVWDTLK-GERVGVLAGHENRVSCL-GVS 324 (343)
T ss_pred E-----------------cccccEEEeeecC-----------------CceeEeeccc-cceEEEeeccCCeeEEE-EEC
Confidence 2 1489999999654 1466666321 11111112344565433 345
Q ss_pred CCCcEEEEcCcC
Q 043369 346 PTGDVLIINGAA 357 (526)
Q Consensus 346 pdG~V~vvGG~~ 357 (526)
|||.-+..|-.+
T Consensus 325 ~DG~av~TgSWD 336 (343)
T KOG0286|consen 325 PDGMAVATGSWD 336 (343)
T ss_pred CCCcEEEecchh
Confidence 788887776543
No 109
>PRK03629 tolB translocation protein TolB; Provisional
Probab=46.40 E-value=3.9e+02 Score=28.41 Aligned_cols=84 Identities=10% Similarity=0.010 Sum_probs=48.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
...+||.++++.+++..... ........+||+.+++.....+...+..+|.. +..-..+ .. ...........+|
T Consensus 268 ~I~~~d~~tg~~~~lt~~~~-~~~~~~wSPDG~~I~f~s~~~g~~~Iy~~d~~-~g~~~~l--t~--~~~~~~~~~~SpD 341 (429)
T PRK03629 268 NLYVMDLASGQIRQVTDGRS-NNTEPTWFPDSQNLAYTSDQAGRPQVYKVNIN-GGAPQRI--TW--EGSQNQDADVSSD 341 (429)
T ss_pred EEEEEECCCCCEEEccCCCC-CcCceEECCCCCEEEEEeCCCCCceEEEEECC-CCCeEEe--ec--CCCCccCEEECCC
Confidence 45678999988888764322 22345667899877665443344567777876 5544333 11 1111223444568
Q ss_pred CcEEEEcCcc
Q 043369 166 GKIIVVGGRF 175 (526)
Q Consensus 166 G~v~viGG~~ 175 (526)
|+.++..+..
T Consensus 342 G~~Ia~~~~~ 351 (429)
T PRK03629 342 GKFMVMVSSN 351 (429)
T ss_pred CCEEEEEEcc
Confidence 8877665544
No 110
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=45.89 E-value=2.9e+02 Score=26.86 Aligned_cols=29 Identities=17% Similarity=0.363 Sum_probs=21.8
Q ss_pred eEEEecCCcEEEEEc--cceEEEeccCCeEE
Q 043369 215 FLHLSTDGNLFIFAN--DRAILLDYVNNRVM 243 (526)
Q Consensus 215 ~~~~~~dG~Iy~~Gg--~~~~~yDp~t~~w~ 243 (526)
.+.+-|.|++++.|- .++.+||...++-.
T Consensus 236 av~vdpsgrll~sg~~dssc~lydirg~r~i 266 (350)
T KOG0641|consen 236 AVAVDPSGRLLASGHADSSCMLYDIRGGRMI 266 (350)
T ss_pred EEEECCCcceeeeccCCCceEEEEeeCCcee
Confidence 345567899999886 35789999988744
No 111
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=45.68 E-value=3e+02 Score=28.63 Aligned_cols=91 Identities=13% Similarity=0.053 Sum_probs=52.2
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
....+|..+++.+.+....... ......+||+.+++.....+...+..+|.. +.++..+ .. ...+......-+|
T Consensus 259 ~i~~~d~~~~~~~~l~~~~~~~-~~~~~s~dg~~l~~~s~~~g~~~iy~~d~~-~~~~~~l--~~--~~~~~~~~~~spd 332 (417)
T TIGR02800 259 DIYVMDLDGKQLTRLTNGPGID-TEPSWSPDGKSIAFTSDRGGSPQIYMMDAD-GGEVRRL--TF--RGGYNASPSWSPD 332 (417)
T ss_pred cEEEEECCCCCEEECCCCCCCC-CCEEECCCCCEEEEEECCCCCceEEEEECC-CCCEEEe--ec--CCCCccCeEECCC
Confidence 4667888888887775432111 123456788876665443444578888887 6666554 11 1222233344468
Q ss_pred CcEEEEcCccCCeEEEE
Q 043369 166 GKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 166 G~v~viGG~~~~~~E~y 182 (526)
|+.+++.........+|
T Consensus 333 g~~i~~~~~~~~~~~i~ 349 (417)
T TIGR02800 333 GDLIAFVHREGGGFNIA 349 (417)
T ss_pred CCEEEEEEccCCceEEE
Confidence 88887776554334444
No 112
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=45.68 E-value=1.6e+02 Score=29.64 Aligned_cols=59 Identities=10% Similarity=0.003 Sum_probs=36.7
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCC--CC--ccEEEEEcCCCCCCcccc
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYR--LG--ERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~--~g--~~~v~~ydp~~t~~W~~~ 146 (526)
....||+.+.+|..+...-.--- ......++.-+++||.. ++ ...+-.||.. +.+|...
T Consensus 17 ~lC~yd~~~~qW~~~g~~i~G~V-~~l~~~~~~~Llv~G~ft~~~~~~~~la~yd~~-~~~w~~~ 79 (281)
T PF12768_consen 17 GLCLYDTDNSQWSSPGNGISGTV-TDLQWASNNQLLVGGNFTLNGTNSSNLATYDFK-NQTWSSL 79 (281)
T ss_pred EEEEEECCCCEeecCCCCceEEE-EEEEEecCCEEEEEEeeEECCCCceeEEEEecC-CCeeeec
Confidence 46789999999998764311100 12223345555555542 22 4567889999 8999877
No 113
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=45.65 E-value=3.6e+02 Score=27.83 Aligned_cols=258 Identities=16% Similarity=0.124 Sum_probs=129.3
Q ss_pred EEEEeCCCCc--EEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCC-CCCcccccCCCCCcccccceeEEe
Q 043369 87 AVEFDPITRK--VRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCS-DCDWEEDHQNGLISPRWYASNQIL 163 (526)
Q Consensus 87 ~~~yDp~t~~--w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~-t~~W~~~~~~~m~~~R~y~s~~~L 163 (526)
...+|+.+.+ |+.........+++.....+|+||+-... + ...+||+.+ +..|... .... .+| .+.++.
T Consensus 80 i~A~d~~~g~~~W~~~~~~~~~~~~~~~~~~~G~i~~g~~~--g--~~y~ld~~~G~~~W~~~--~~~~-~~~-~~~~v~ 151 (370)
T COG1520 80 IFALNPDTGLVKWSYPLLGAVAQLSGPILGSDGKIYVGSWD--G--KLYALDASTGTLVWSRN--VGGS-PYY-ASPPVV 151 (370)
T ss_pred EEEEeCCCCcEEecccCcCcceeccCceEEeCCeEEEeccc--c--eEEEEECCCCcEEEEEe--cCCC-eEE-ecCcEE
Confidence 5568888877 76544333455777777789998775443 2 688899842 5679865 2222 565 445556
Q ss_pred cCCcEEEEcCccCCeEEEEcCCCCCCCcceee-cCC-ccccCCCCCCCCCCcceEEEecCCcEEEEEcc---ceEEEecc
Q 043369 164 PNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQ-LPF-LKETMHSPKIPNNLYPFLHLSTDGNLFIFAND---RAILLDYV 238 (526)
Q Consensus 164 ~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~-~p~-l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~---~~~~yDp~ 238 (526)
.|+.||+.- .++..+-+.+.+.. ..|.. .+. +.... + ......+|.+|+-... ...-+|+.
T Consensus 152 ~~~~v~~~s-~~g~~~al~~~tG~---~~W~~~~~~~~~~~~---------~-~~~~~~~~~vy~~~~~~~~~~~a~~~~ 217 (370)
T COG1520 152 GDGTVYVGT-DDGHLYALNADTGT---LKWTYETPAPLSLSI---------Y-GSPAIASGTVYVGSDGYDGILYALNAE 217 (370)
T ss_pred cCcEEEEec-CCCeEEEEEccCCc---EEEEEecCCcccccc---------c-cCceeecceEEEecCCCcceEEEEEcc
Confidence 689999875 11222222244442 25642 221 11110 0 1112457777765431 24557776
Q ss_pred CC--eEEEeccCCCCCCCCccCCCCceeecccccccccccccCCCCCccCcEEEEEcCCCCCCCchhhhhhcccccccce
Q 043369 239 NN--RVMKNYPVMPGGISRNYPSTGSSVLLPVNLSSINVHINNNNKPVVHSQVLICGGTLPDSNENAAEAQIFLPAAKSC 316 (526)
Q Consensus 239 t~--~w~~~~p~~p~~~~r~y~~~g~~v~lp~~~~~~~~~~~~~~~~~~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~ 316 (526)
++ .|.+.. ..+.. +. ... .. ..+..+.|++.|+.-... .....
T Consensus 218 ~G~~~w~~~~-~~~~~--~~----~~~-~~---------------~~~~~~~v~v~~~~~~~~------------~~g~~ 262 (370)
T COG1520 218 DGTLKWSQKV-SQTIG--RT----AIS-TT---------------PAVDGGPVYVDGGVYAGS------------YGGKL 262 (370)
T ss_pred CCcEeeeeee-ecccC--cc----ccc-cc---------------ccccCceEEECCcEEEEe------------cCCeE
Confidence 65 454211 11111 11 110 00 123577888887731111 11225
Q ss_pred EEEEeecCCCCceec-cc--CccccccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCC----cEeecCCC
Q 043369 317 GRLTITAQNPKWEME-EM--PLNRVMGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKIN----RFRILSPS 389 (526)
Q Consensus 317 ~~~d~~~~~~~W~~~-~M--~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~----~Wt~~a~~ 389 (526)
.++|..+....|+.. ++ ...+.+.....--||++|+..-..... ....+.++++..+ .|.....-
T Consensus 263 ~~l~~~~G~~~W~~~~~~~~~~~~~~~~~~~~~dG~v~~~~~~~~~~--------~~~~~~~~~~~~g~~~~~w~~~~~g 334 (370)
T COG1520 263 LCLDADTGELIWSFPAGGSVQGSGLYTTPVAGADGKVYIGFTDNDGR--------GSGSLYALADVPGGTLLKWSYPVGG 334 (370)
T ss_pred EEEEcCCCceEEEEecccEeccCCeeEEeecCCCccEEEEEeccccc--------cccceEEEeccCCCeeEEEEEeCCC
Confidence 677776656789875 42 222333333333599999976543110 1223455554222 46543332
Q ss_pred CccccccccceecCCCEEEEecCC
Q 043369 390 LIPRLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 390 ~~~R~yhs~a~LlpdG~V~v~GG~ 413 (526)
.+.......-||.+|.++-+
T Consensus 335 ----~~~~~~~~~~~g~~y~~~~~ 354 (370)
T COG1520 335 ----GYSLSTVAGSDGTLYFGGDD 354 (370)
T ss_pred ----ceecccceeccCeEEecccC
Confidence 22222333457777776554
No 114
>PF13540 RCC1_2: Regulator of chromosome condensation (RCC1) repeat; PDB: 3QI0_D 1JTD_B 3QHY_B.
Probab=45.39 E-value=19 Score=22.93 Aligned_cols=22 Identities=45% Similarity=0.517 Sum_probs=14.3
Q ss_pred cccccceecCCCEEEEecCCCCC
Q 043369 394 LYHSTAHLLSDGRVLVGGSNPNV 416 (526)
Q Consensus 394 ~yhs~a~LlpdG~V~v~GG~~~~ 416 (526)
.+|+++ |+.||+||.-|.+..+
T Consensus 8 ~~ht~a-l~~~g~v~~wG~n~~G 29 (30)
T PF13540_consen 8 GYHTCA-LTSDGEVYCWGDNNYG 29 (30)
T ss_dssp SSEEEE-EE-TTEEEEEE--TTS
T ss_pred CCEEEE-EEcCCCEEEEcCCcCC
Confidence 468755 4579999999987553
No 115
>PRK03629 tolB translocation protein TolB; Provisional
Probab=44.83 E-value=4.1e+02 Score=28.23 Aligned_cols=138 Identities=10% Similarity=0.036 Sum_probs=70.4
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
...++|..+++-+.+...... ......-+||+.+++-...++...+.++|.. +.+...+ ..-.. ......--+|
T Consensus 224 ~i~i~dl~~G~~~~l~~~~~~-~~~~~~SPDG~~La~~~~~~g~~~I~~~d~~-tg~~~~l--t~~~~--~~~~~~wSPD 297 (429)
T PRK03629 224 ALVIQTLANGAVRQVASFPRH-NGAPAFSPDGSKLAFALSKTGSLNLYVMDLA-SGQIRQV--TDGRS--NNTEPTWFPD 297 (429)
T ss_pred EEEEEECCCCCeEEccCCCCC-cCCeEECCCCCEEEEEEcCCCCcEEEEEECC-CCCEEEc--cCCCC--CcCceEECCC
Confidence 456788888887776543322 2234667899866654333444578889987 6655544 11110 1122333468
Q ss_pred CcEEEEcCccCCeEEEE--cCCCCCCCcceeecCCccccCCCCCCCCCCcceEEEecCCcEEEEEcc-----ceEEEecc
Q 043369 166 GKIIVVGGRFQFTYEFI--PRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFAND-----RAILLDYV 238 (526)
Q Consensus 166 G~v~viGG~~~~~~E~y--P~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~-----~~~~yDp~ 238 (526)
|+-++..........+| .... .....+... .. ... .....+||+.+++... ...++|..
T Consensus 298 G~~I~f~s~~~g~~~Iy~~d~~~----g~~~~lt~~-~~-------~~~--~~~~SpDG~~Ia~~~~~~g~~~I~~~dl~ 363 (429)
T PRK03629 298 SQNLAYTSDQAGRPQVYKVNING----GAPQRITWE-GS-------QNQ--DADVSSDGKFMVMVSSNGGQQHIAKQDLA 363 (429)
T ss_pred CCEEEEEeCCCCCceEEEEECCC----CCeEEeecC-CC-------Ccc--CEEECCCCCEEEEEEccCCCceEEEEECC
Confidence 87555443222223444 2221 022222110 00 011 1235678877766542 35667888
Q ss_pred CCeEE
Q 043369 239 NNRVM 243 (526)
Q Consensus 239 t~~w~ 243 (526)
++++.
T Consensus 364 ~g~~~ 368 (429)
T PRK03629 364 TGGVQ 368 (429)
T ss_pred CCCeE
Confidence 88765
No 116
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=44.55 E-value=1.9e+02 Score=35.02 Aligned_cols=63 Identities=14% Similarity=0.226 Sum_probs=37.4
Q ss_pred eEcCCCcEEEEcCCCCCccEEEEEcCCCCCCccccc-------------CCCCCcccccceeEEecCCcEEEEcCccCCe
Q 043369 112 ALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDH-------------QNGLISPRWYASNQILPNGKIIVVGGRFQFT 178 (526)
Q Consensus 112 ~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~-------------~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~ 178 (526)
++.++|.|||+-.. ...+++||+. +....... .+.+..|+ +++.-+||++||.-..+ ..
T Consensus 810 avd~dG~LYVADs~---N~rIrviD~~-tg~v~tiaG~G~~G~~dG~~~~a~l~~P~---GIavd~dG~lyVaDt~N-n~ 881 (1057)
T PLN02919 810 LCAKDGQIYVADSY---NHKIKKLDPA-TKRVTTLAGTGKAGFKDGKALKAQLSEPA---GLALGENGRLFVADTNN-SL 881 (1057)
T ss_pred eEeCCCcEEEEECC---CCEEEEEECC-CCeEEEEeccCCcCCCCCcccccccCCce---EEEEeCCCCEEEEECCC-CE
Confidence 44568999998644 3689999997 55443220 01222222 34555689999886543 34
Q ss_pred EEEE
Q 043369 179 YEFI 182 (526)
Q Consensus 179 ~E~y 182 (526)
+.++
T Consensus 882 Irvi 885 (1057)
T PLN02919 882 IRYL 885 (1057)
T ss_pred EEEE
Confidence 5666
No 117
>TIGR02608 delta_60_rpt delta-60 repeat domain. This domain occurs in tandem repeats, as many as 13, in proteins from Bdellovibrio bacteriovorus, Azotobacter vinelandii, Geobacter sulfurreducens, Pirellula sp. 1, Myxococcus xanthus, and others, many of which are Deltaproteobacteria. The periodicity of the repeat ranges from about 57 to 61 amino acids, and a core region of about 54 is represented by this model and seed alignment.
Probab=42.14 E-value=17 Score=27.12 Aligned_cols=16 Identities=38% Similarity=0.594 Sum_probs=12.7
Q ss_pred ceecCCCEEEEecCCC
Q 043369 399 AHLLSDGRVLVGGSNP 414 (526)
Q Consensus 399 a~LlpdG~V~v~GG~~ 414 (526)
..+.|||||+++|...
T Consensus 6 ~~~q~DGkIlv~G~~~ 21 (55)
T TIGR02608 6 VAVQSDGKILVAGYVD 21 (55)
T ss_pred EEECCCCcEEEEEEee
Confidence 4567999999999753
No 118
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=42.07 E-value=1.3e+02 Score=33.11 Aligned_cols=93 Identities=17% Similarity=0.204 Sum_probs=50.2
Q ss_pred cCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCcccc-------ccceEEeCCCcEEEEcCc
Q 043369 285 VHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRV-------MGDMILLPTGDVLIINGA 356 (526)
Q Consensus 285 ~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~-------~~~~vvLpdG~V~vvGG~ 356 (526)
.+++||+..... .+.++|..+....|+.. ..+.... ....+++-+++||+....
T Consensus 68 ~~g~vyv~s~~g------------------~v~AlDa~TGk~lW~~~~~~~~~~~~~~~~~~~~rg~av~~~~v~v~t~d 129 (527)
T TIGR03075 68 VDGVMYVTTSYS------------------RVYALDAKTGKELWKYDPKLPDDVIPVMCCDVVNRGVALYDGKVFFGTLD 129 (527)
T ss_pred ECCEEEEECCCC------------------cEEEEECCCCceeeEecCCCCcccccccccccccccceEECCEEEEEcCC
Confidence 478888865421 35678876556678864 2221100 011234558888874321
Q ss_pred CCCCCCccCCCCCccccEEEeCCCC--cEeecC-CCCccccc-cccceecCCCEEEEec
Q 043369 357 AKGTAGWGAAREPVLNPVIYCPKIN--RFRILS-PSLIPRLY-HSTAHLLSDGRVLVGG 411 (526)
Q Consensus 357 ~~g~~g~~~~~~~~~~~e~YDP~t~--~Wt~~a-~~~~~R~y-hs~a~LlpdG~V~v~G 411 (526)
. .+..+|.++. .|+.-. ... ..+ ..++-++-+|+|++..
T Consensus 130 g--------------~l~ALDa~TGk~~W~~~~~~~~--~~~~~tssP~v~~g~Vivg~ 172 (527)
T TIGR03075 130 A--------------RLVALDAKTGKVVWSKKNGDYK--AGYTITAAPLVVKGKVITGI 172 (527)
T ss_pred C--------------EEEEEECCCCCEEeeccccccc--ccccccCCcEEECCEEEEee
Confidence 1 4578898888 586532 211 111 1223344589998864
No 119
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=41.29 E-value=1.6e+02 Score=28.90 Aligned_cols=93 Identities=16% Similarity=0.033 Sum_probs=56.0
Q ss_pred ceEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEec
Q 043369 85 AHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILP 164 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~ 164 (526)
....+||.+|++....--.|..--....+--+-.+++.|+++ .++++||-. +....+. .-+...+-.-+...+.
T Consensus 81 k~v~vwDV~TGkv~Rr~rgH~aqVNtV~fNeesSVv~SgsfD---~s~r~wDCR-S~s~ePi--Qildea~D~V~Si~v~ 154 (307)
T KOG0316|consen 81 KAVQVWDVNTGKVDRRFRGHLAQVNTVRFNEESSVVASGSFD---SSVRLWDCR-SRSFEPI--QILDEAKDGVSSIDVA 154 (307)
T ss_pred ceEEEEEcccCeeeeecccccceeeEEEecCcceEEEecccc---ceeEEEEcc-cCCCCcc--chhhhhcCceeEEEec
Confidence 467889999987644322222111111122345777888874 689999988 7777666 4566777666666663
Q ss_pred CCcEEEEcCccCCeEEEE-cCC
Q 043369 165 NGKIIVVGGRFQFTYEFI-PRT 185 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y-P~~ 185 (526)
+. -|++|+-..++..| -+.
T Consensus 155 -~h-eIvaGS~DGtvRtydiR~ 174 (307)
T KOG0316|consen 155 -EH-EIVAGSVDGTVRTYDIRK 174 (307)
T ss_pred -cc-EEEeeccCCcEEEEEeec
Confidence 33 44566554567777 443
No 120
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=40.17 E-value=2e+02 Score=29.87 Aligned_cols=81 Identities=17% Similarity=0.220 Sum_probs=42.4
Q ss_pred ceEEEEeCCCCcEEe-CccC---------CccccccceEcCCCcEEEEcCCCCC---ccEEEEEcCCCCCCcccccCCCC
Q 043369 85 AHAVEFDPITRKVRP-LTIQ---------TDTWCSSGALLANGVLVQTGGYRLG---ERVVRYLKPCSDCDWEEDHQNGL 151 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~-~~~~---------~~~fc~~~~~l~~G~l~v~GG~~~g---~~~v~~ydp~~t~~W~~~~~~~m 151 (526)
+.+.+-|.+.+++-. ++.+ .+.| .+.=.||+++.+.=..+| .+..++||+. .+-..+. + .+
T Consensus 118 ~SVtVVDl~~~kvv~ei~~PGC~~iyP~~~~~F---~~lC~DGsl~~v~Ld~~Gk~~~~~t~~F~~~-~dp~f~~-~-~~ 191 (342)
T PF06433_consen 118 TSVTVVDLAAKKVVGEIDTPGCWLIYPSGNRGF---SMLCGDGSLLTVTLDADGKEAQKSTKVFDPD-DDPLFEH-P-AY 191 (342)
T ss_dssp EEEEEEETTTTEEEEEEEGTSEEEEEEEETTEE---EEEETTSCEEEEEETSTSSEEEEEEEESSTT-TS-B-S----EE
T ss_pred CeEEEEECCCCceeeeecCCCEEEEEecCCCce---EEEecCCceEEEEECCCCCEeEeeccccCCC-Ccccccc-c-ce
Confidence 567888999888743 2211 1222 122236666665422223 3456789997 5544443 1 11
Q ss_pred --CcccccceeEEecCCcEEE--EcCc
Q 043369 152 --ISPRWYASNQILPNGKIIV--VGGR 174 (526)
Q Consensus 152 --~~~R~y~s~~~L~dG~v~v--iGG~ 174 (526)
...|||. .+. +|+||. ++|.
T Consensus 192 ~~~~~~~~F--~Sy-~G~v~~~dlsg~ 215 (342)
T PF06433_consen 192 SRDGGRLYF--VSY-EGNVYSADLSGD 215 (342)
T ss_dssp ETTTTEEEE--EBT-TSEEEEEEETTS
T ss_pred ECCCCeEEE--Eec-CCEEEEEeccCC
Confidence 2345654 456 899998 4554
No 121
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=38.96 E-value=4.7e+02 Score=27.26 Aligned_cols=17 Identities=6% Similarity=0.157 Sum_probs=13.1
Q ss_pred cceEEEeccCCeEEEec
Q 043369 230 DRAILLDYVNNRVMKNY 246 (526)
Q Consensus 230 ~~~~~yDp~t~~w~~~~ 246 (526)
+..+++|.++.+....+
T Consensus 279 ~~V~ViD~~t~kvi~~i 295 (352)
T TIGR02658 279 RFLFVVDAKTGKRLRKI 295 (352)
T ss_pred CEEEEEECCCCeEEEEE
Confidence 46899999998876544
No 122
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=38.34 E-value=53 Score=30.92 Aligned_cols=56 Identities=16% Similarity=0.222 Sum_probs=36.8
Q ss_pred EeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCC
Q 043369 344 LLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSN 413 (526)
Q Consensus 344 vLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~ 413 (526)
--|+|+.++++|.. ... -.+++||.. +++.+.....+.. +...--||||-+++-..
T Consensus 108 wsP~G~~l~~~g~~-n~~---------G~l~~wd~~--~~~~i~~~~~~~~--t~~~WsPdGr~~~ta~t 163 (194)
T PF08662_consen 108 WSPDGRFLVLAGFG-NLN---------GDLEFWDVR--KKKKISTFEHSDA--TDVEWSPDGRYLATATT 163 (194)
T ss_pred ECCCCCEEEEEEcc-CCC---------cEEEEEECC--CCEEeeccccCcE--EEEEEcCCCCEEEEEEe
Confidence 45999999999975 221 157999987 4555544433322 23445699999988663
No 123
>PRK05137 tolB translocation protein TolB; Provisional
Probab=37.48 E-value=5.2e+02 Score=27.34 Aligned_cols=83 Identities=13% Similarity=0.080 Sum_probs=47.2
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
....+|..+++.+++..... ........+||+-+++.....+...+.++|.. +.....+ .. ....+.....-+|
T Consensus 271 ~Iy~~d~~~~~~~~Lt~~~~-~~~~~~~spDG~~i~f~s~~~g~~~Iy~~d~~-g~~~~~l--t~--~~~~~~~~~~Spd 344 (435)
T PRK05137 271 DIYTMDLRSGTTTRLTDSPA-IDTSPSYSPDGSQIVFESDRSGSPQLYVMNAD-GSNPRRI--SF--GGGRYSTPVWSPR 344 (435)
T ss_pred eEEEEECCCCceEEccCCCC-ccCceeEcCCCCEEEEEECCCCCCeEEEEECC-CCCeEEe--ec--CCCcccCeEECCC
Confidence 45667998888887754221 12234567899877765544455678888876 5544443 11 1122333334468
Q ss_pred CcEEEEcCc
Q 043369 166 GKIIVVGGR 174 (526)
Q Consensus 166 G~v~viGG~ 174 (526)
|+.+++...
T Consensus 345 G~~ia~~~~ 353 (435)
T PRK05137 345 GDLIAFTKQ 353 (435)
T ss_pred CCEEEEEEc
Confidence 877666443
No 124
>PF03089 RAG2: Recombination activating protein 2; InterPro: IPR004321 The variable portion of the genes encoding immunoglobulins and T cell receptors are assembled from component V, D, and J DNA segments by a site-specific recombination reaction termed V(D)J recombination. V(D)J recombination is targeted to specific sites on the chromosome by recombination signal sequences (RSSs) that flank antigen receptor gene segments. The RSS consists of a conserved heptamer (consensus, 5'-CACAGTG-3') and nonamer (consensus, 5'-ACAAAAACC-3') separated by a spacer of either 12 or 23 bp. Efficient recombination occurs between a 12-RSS and a 23-RSS, a restriction known as the 12/23 rule. V(D)J recombination can be divided into two phases, DNA cleavage and DNA joining. DNA cleavage requires two lymphocyte-specific factors, the products of the recombination activating genes, RAG1 and RAG2, which together recognise the RSSs and create double strand breaks at the RSS-coding segment junctions []. RAG-mediated DNA cleavage occurs in a synaptic complex termed the paired complex, which is constituted from two distinct RSS-RAG complexes, a 12-SC and a 23-SC (where SC stands for signal complex). The DNA cleavage reaction involves two distinct enzymatic steps, initial nicking that creates a 3'-OH between a coding segment and its RSS, followed by hairpin formation in which the newly created 3'-OH attacks a phosphodiester bond on the opposite DNA strand. This generates a blunt, 5' phosphorylated signal end containing all of the RSS elements, and a covalently sealed hairpin coding end. The second phase of V(D)J recombination, in which broken DNA fragments are processed and joined, is less well characterised. Signal ends are typically joined precisely to form a signal joint, whereas joining of the coding ends requires the hairpin structure to be opened and typically involves nucleotide addition and deletion before formation of the coding joint. The factors involved in these processes include ubiquitously expressed proteins involved in the repair of DNA double strand breaks by nonhomologous end joining, terminal deoxynucleotidyl transferase, and Artemis protein. In addition to their critical roles in RSS recognition and DNA cleavage, the RAG proteins may perform two distinct types of functions in the postcleavage phase of V(D)J. A structural function has been inferred from the finding that, after DNA cleavage in vitro, the DNA ends remain associated with the RAG proteins in a "four end" complex known as the cleaved signal complex. After release of the coding ends in vitro, and after coding joint formation in vivo, the RAG proteins remain in a stable signal end complex (SEC) containing the two signal ends. These postcleavage complexes may serve as essential scaffolds for the second phase of the reaction, with the RAG proteins acting to organise the DNA processing and joining events. The second type of RAG protein-mediated postcleavage activity is the catalysis of phosphodiester bond hydrolysis and strand transfer reactions. The RAG proteins are capable of opening hairpin coding ends in vitro. The RAG proteins also show 3' flap endonuclease activity that may contribute to coding end processing/joining and can utilise the 3' OH group on the signal ends to attack hairpin coding ends (forming hybrid or open/shut joints) or virtually any DNA duplex (forming a transposition product).; GO: 0003677 DNA binding, 0006310 DNA recombination, 0005634 nucleus
Probab=36.65 E-value=1.1e+02 Score=30.84 Aligned_cols=82 Identities=12% Similarity=0.167 Sum_probs=50.9
Q ss_pred ccCccccccceE-EeCCCc--EEEEcCcCCCC------CCccCCCCCccccEEEeCCCCcEe--ecCCCCccccccccce
Q 043369 332 EMPLNRVMGDMI-LLPTGD--VLIINGAAKGT------AGWGAAREPVLNPVIYCPKINRFR--ILSPSLIPRLYHSTAH 400 (526)
Q Consensus 332 ~M~~~R~~~~~v-vLpdG~--V~vvGG~~~g~------~g~~~~~~~~~~~e~YDP~t~~Wt--~~a~~~~~R~yhs~a~ 400 (526)
+.|.+|..|++- +.-.|| +.++||..+-. ..|..--+-..++-+.|.+-.-.+ .++.+.....+|- .
T Consensus 83 dvP~aRYGHt~~vV~SrGKta~VlFGGRSY~P~~qRTTenWNsVvDC~P~VfLiDleFGC~tah~lpEl~dG~SFHv--s 160 (337)
T PF03089_consen 83 DVPEARYGHTINVVHSRGKTACVLFGGRSYMPPGQRTTENWNSVVDCPPQVFLIDLEFGCCTAHTLPELQDGQSFHV--S 160 (337)
T ss_pred CCCcccccceEEEEEECCcEEEEEECCcccCCccccchhhcceeccCCCeEEEEeccccccccccchhhcCCeEEEE--E
Confidence 789999988763 344554 56678865311 113211112234566777766544 4666777788884 3
Q ss_pred ecCCCEEEEecCCCC
Q 043369 401 LLSDGRVLVGGSNPN 415 (526)
Q Consensus 401 LlpdG~V~v~GG~~~ 415 (526)
|-.+..||+.||..-
T Consensus 161 lar~D~VYilGGHsl 175 (337)
T PF03089_consen 161 LARNDCVYILGGHSL 175 (337)
T ss_pred EecCceEEEEccEEc
Confidence 456999999999643
No 125
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=35.71 E-value=5.2e+02 Score=26.79 Aligned_cols=59 Identities=8% Similarity=-0.052 Sum_probs=34.8
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
...+||..+++.+.+...... .......+||+-+++....++...+..+|.. +.....+
T Consensus 215 ~i~v~d~~~g~~~~~~~~~~~-~~~~~~spDg~~l~~~~~~~~~~~i~~~d~~-~~~~~~l 273 (417)
T TIGR02800 215 EIYVQDLATGQREKVASFPGM-NGAPAFSPDGSKLAVSLSKDGNPDIYVMDLD-GKQLTRL 273 (417)
T ss_pred EEEEEECCCCCEEEeecCCCC-ccceEECCCCCEEEEEECCCCCccEEEEECC-CCCEEEC
Confidence 467789988877666543221 1224567888755443332344578888887 6554443
No 126
>PRK04792 tolB translocation protein TolB; Provisional
Probab=35.35 E-value=5.9e+02 Score=27.27 Aligned_cols=59 Identities=8% Similarity=-0.071 Sum_probs=36.5
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
...++|+.+++.+.+...... -......+||+-+++-...++...+.++|.. +.+...+
T Consensus 243 ~L~~~dl~tg~~~~lt~~~g~-~~~~~wSPDG~~La~~~~~~g~~~Iy~~dl~-tg~~~~l 301 (448)
T PRK04792 243 EIFVQDIYTQVREKVTSFPGI-NGAPRFSPDGKKLALVLSKDGQPEIYVVDIA-TKALTRI 301 (448)
T ss_pred EEEEEECCCCCeEEecCCCCC-cCCeeECCCCCEEEEEEeCCCCeEEEEEECC-CCCeEEC
Confidence 466789888887766543221 1134567899855553333445678888987 7766554
No 127
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=33.52 E-value=5.5e+02 Score=28.06 Aligned_cols=134 Identities=17% Similarity=0.129 Sum_probs=69.0
Q ss_pred eEEEEeCCCCc----EEeCccC-CccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCc--ccccc
Q 043369 86 HAVEFDPITRK----VRPLTIQ-TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLIS--PRWYA 158 (526)
Q Consensus 86 ~~~~yDp~t~~----w~~~~~~-~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~--~R~y~ 158 (526)
.+-+||..-.. ..++..+ .+.|-...-.++||+-+++||.. .++.++|-. .-+=.-. ..|.. +-+|+
T Consensus 441 cVKVWdis~pg~k~PvsqLdcl~rdnyiRSckL~pdgrtLivGGea---stlsiWDLA-apTprik--aeltssapaCyA 514 (705)
T KOG0639|consen 441 CVKVWDISQPGNKSPVSQLDCLNRDNYIRSCKLLPDGRTLIVGGEA---STLSIWDLA-APTPRIK--AELTSSAPACYA 514 (705)
T ss_pred eEEEeeccCCCCCCccccccccCcccceeeeEecCCCceEEecccc---ceeeeeecc-CCCcchh--hhcCCcchhhhh
Confidence 46678864321 3345544 46666667789999999999983 677888876 3322211 23433 44554
Q ss_pred eeEEecCCcEEEEcCccCCeEEEEcCCCCCCCcceeecCCccccCCCCCCCCCCcceE-EEecCCcEEEEEcc--ceEEE
Q 043369 159 SNQILPNGKIIVVGGRFQFTYEFIPRTSDSDRKILYQLPFLKETMHSPKIPNNLYPFL-HLSTDGNLFIFAND--RAILL 235 (526)
Q Consensus 159 s~~~L~dG~v~viGG~~~~~~E~yP~~~~~~~~~w~~~p~l~~~~~~~~~~~~~yp~~-~~~~dG~Iy~~Gg~--~~~~y 235 (526)
-++. +|-+|...-=+++ .+.+|...+.. .-..++ .-.| ...+ -+..||.-++.||- .+.+|
T Consensus 515 La~s-pDakvcFsccsdG-nI~vwDLhnq~---~Vrqfq---GhtD--------GascIdis~dGtklWTGGlDntvRcW 578 (705)
T KOG0639|consen 515 LAIS-PDAKVCFSCCSDG-NIAVWDLHNQT---LVRQFQ---GHTD--------GASCIDISKDGTKLWTGGLDNTVRCW 578 (705)
T ss_pred hhcC-CccceeeeeccCC-cEEEEEcccce---eeeccc---CCCC--------CceeEEecCCCceeecCCCccceeeh
Confidence 3333 3666644332222 34455322210 011111 1111 1112 23347877777873 46677
Q ss_pred eccCCe
Q 043369 236 DYVNNR 241 (526)
Q Consensus 236 Dp~t~~ 241 (526)
|..+.+
T Consensus 579 Dlregr 584 (705)
T KOG0639|consen 579 DLREGR 584 (705)
T ss_pred hhhhhh
Confidence 777654
No 128
>PRK01742 tolB translocation protein TolB; Provisional
Probab=33.22 E-value=4.5e+02 Score=27.84 Aligned_cols=80 Identities=11% Similarity=0.020 Sum_probs=44.0
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccc-cceeEEec
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRW-YASNQILP 164 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~-y~s~~~L~ 164 (526)
...++|..+++.+.+...... ......-+||+.++++...++...+..+|.. +.....+ ..... ....+--+
T Consensus 229 ~i~i~dl~tg~~~~l~~~~g~-~~~~~wSPDG~~La~~~~~~g~~~Iy~~d~~-~~~~~~l-----t~~~~~~~~~~wSp 301 (429)
T PRK01742 229 QLVVHDLRSGARKVVASFRGH-NGAPAFSPDGSRLAFASSKDGVLNIYVMGAN-GGTPSQL-----TSGAGNNTEPSWSP 301 (429)
T ss_pred EEEEEeCCCCceEEEecCCCc-cCceeECCCCCEEEEEEecCCcEEEEEEECC-CCCeEee-----ccCCCCcCCEEECC
Confidence 456788888776655433211 1234667899877776544454567777876 5554443 11111 12233446
Q ss_pred CCcEEEEc
Q 043369 165 NGKIIVVG 172 (526)
Q Consensus 165 dG~v~viG 172 (526)
||+-+++.
T Consensus 302 DG~~i~f~ 309 (429)
T PRK01742 302 DGQSILFT 309 (429)
T ss_pred CCCEEEEE
Confidence 88754443
No 129
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=31.90 E-value=72 Score=33.63 Aligned_cols=86 Identities=21% Similarity=0.094 Sum_probs=49.2
Q ss_pred EEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcE
Q 043369 89 EFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKI 168 (526)
Q Consensus 89 ~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v 168 (526)
+||..|++=--+-..|..--...++-+||.++..||.+ ...+++|-. +.+-...- .. .-+--.++.--+||..
T Consensus 287 lWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD---~~~RvWDlR-tgr~im~L-~g--H~k~I~~V~fsPNGy~ 359 (459)
T KOG0272|consen 287 LWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLD---SLGRVWDLR-TGRCIMFL-AG--HIKEILSVAFSPNGYH 359 (459)
T ss_pred hcccccchhhHhhcccccccceeEecCCCceeeccCcc---chhheeecc-cCcEEEEe-cc--cccceeeEeECCCceE
Confidence 34544443222223344434446778899999999985 344666766 54433220 00 1122345666779999
Q ss_pred EEEcCccCCeEEEE
Q 043369 169 IVVGGRFQFTYEFI 182 (526)
Q Consensus 169 ~viGG~~~~~~E~y 182 (526)
++.||.++ ++.+|
T Consensus 360 lATgs~Dn-t~kVW 372 (459)
T KOG0272|consen 360 LATGSSDN-TCKVW 372 (459)
T ss_pred EeecCCCC-cEEEe
Confidence 99999875 34455
No 130
>PRK00178 tolB translocation protein TolB; Provisional
Probab=31.35 E-value=5.8e+02 Score=26.79 Aligned_cols=107 Identities=16% Similarity=0.113 Sum_probs=0.0
Q ss_pred cCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCC
Q 043369 48 PNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRL 127 (526)
Q Consensus 48 ~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~ 127 (526)
|+|+-+++.....+ .....++|..+++.+++.. ...........+||+-+++....+
T Consensus 252 pDG~~la~~~~~~g----------------------~~~Iy~~d~~~~~~~~lt~-~~~~~~~~~~spDg~~i~f~s~~~ 308 (430)
T PRK00178 252 PDGSKLAFVLSKDG----------------------NPEIYVMDLASRQLSRVTN-HPAIDTEPFWGKDGRTLYFTSDRG 308 (430)
T ss_pred CCCCEEEEEEccCC----------------------CceEEEEECCCCCeEEccc-CCCCcCCeEECCCCCEEEEEECCC
Q ss_pred CccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEEE
Q 043369 128 GERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 128 g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~y 182 (526)
+...+..+|.. +.++..+ ....+.+.....-+||+.++.-........+|
T Consensus 309 g~~~iy~~d~~-~g~~~~l----t~~~~~~~~~~~Spdg~~i~~~~~~~~~~~l~ 358 (430)
T PRK00178 309 GKPQIYKVNVN-GGRAERV----TFVGNYNARPRLSADGKTLVMVHRQDGNFHVA 358 (430)
T ss_pred CCceEEEEECC-CCCEEEe----ecCCCCccceEECCCCCEEEEEEccCCceEEE
No 131
>PRK04922 tolB translocation protein TolB; Provisional
Probab=31.11 E-value=6.6e+02 Score=26.58 Aligned_cols=81 Identities=16% Similarity=0.128 Sum_probs=47.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
...++|+.+++.+++...... .......+||+-+++.....+...+..+|.. +.+...+ . ...++....+.-+|
T Consensus 273 ~Iy~~d~~~g~~~~lt~~~~~-~~~~~~spDG~~l~f~sd~~g~~~iy~~dl~-~g~~~~l--t--~~g~~~~~~~~SpD 346 (433)
T PRK04922 273 EIYVMDLGSRQLTRLTNHFGI-DTEPTWAPDGKSIYFTSDRGGRPQIYRVAAS-GGSAERL--T--FQGNYNARASVSPD 346 (433)
T ss_pred eEEEEECCCCCeEECccCCCC-ccceEECCCCCEEEEEECCCCCceEEEEECC-CCCeEEe--e--cCCCCccCEEECCC
Confidence 467789999888777532211 1234567899877766543444567777876 6666544 1 11233333444568
Q ss_pred CcEEEEc
Q 043369 166 GKIIVVG 172 (526)
Q Consensus 166 G~v~viG 172 (526)
|+.+++.
T Consensus 347 G~~Ia~~ 353 (433)
T PRK04922 347 GKKIAMV 353 (433)
T ss_pred CCEEEEE
Confidence 8766654
No 132
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=31.10 E-value=5.4e+02 Score=25.62 Aligned_cols=64 Identities=14% Similarity=0.093 Sum_probs=39.7
Q ss_pred cceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCccccc--ceeEEecCCcEEEEcCccCCeEEEE
Q 043369 110 SGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWY--ASNQILPNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 110 ~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y--~s~~~L~dG~v~viGG~~~~~~E~y 182 (526)
+++.-++..+||.||.. ..+..||-. ++.=.. .-+..... +++---+||.+|++|-.++ ++.+|
T Consensus 229 SASL~P~k~~fVaGged---~~~~kfDy~-TgeEi~----~~nkgh~gpVhcVrFSPdGE~yAsGSEDG-TirlW 294 (334)
T KOG0278|consen 229 SASLHPKKEFFVAGGED---FKVYKFDYN-TGEEIG----SYNKGHFGPVHCVRFSPDGELYASGSEDG-TIRLW 294 (334)
T ss_pred cccccCCCceEEecCcc---eEEEEEecc-CCceee----ecccCCCCceEEEEECCCCceeeccCCCc-eEEEE
Confidence 35567788999999973 577888877 543111 11222222 3444457999999987664 44444
No 133
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=30.13 E-value=7.6e+02 Score=27.00 Aligned_cols=82 Identities=12% Similarity=0.025 Sum_probs=50.2
Q ss_pred eEEEEeCCCCcEEeCccC-CccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCc-ccccceeEEe
Q 043369 86 HAVEFDPITRKVRPLTIQ-TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLIS-PRWYASNQIL 163 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~-~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~-~R~y~s~~~L 163 (526)
.+.+|+-.+++.+.+... .+..|+ -..-.+|..+++|=.. ..+++||.. +..=.+ .|.. ...+-++..-
T Consensus 198 ~vylW~~~s~~v~~l~~~~~~~vtS-v~ws~~G~~LavG~~~---g~v~iwD~~-~~k~~~----~~~~~h~~rvg~laW 268 (484)
T KOG0305|consen 198 SVYLWSASSGSVTELCSFGEELVTS-VKWSPDGSHLAVGTSD---GTVQIWDVK-EQKKTR----TLRGSHASRVGSLAW 268 (484)
T ss_pred eEEEEecCCCceEEeEecCCCceEE-EEECCCCCEEEEeecC---CeEEEEehh-hccccc----cccCCcCceeEEEec
Confidence 567788888887777655 333332 2334579999998542 479999987 443222 2333 2222344444
Q ss_pred cCCcEEEEcCccCC
Q 043369 164 PNGKIIVVGGRFQF 177 (526)
Q Consensus 164 ~dG~v~viGG~~~~ 177 (526)
++.++..|.++..
T Consensus 269 -~~~~lssGsr~~~ 281 (484)
T KOG0305|consen 269 -NSSVLSSGSRDGK 281 (484)
T ss_pred -cCceEEEecCCCc
Confidence 6888999887753
No 134
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=29.76 E-value=6.7e+02 Score=26.26 Aligned_cols=30 Identities=20% Similarity=0.289 Sum_probs=16.9
Q ss_pred ccceeEEecCCcEEEEcCccCCeEEEE-cCCC
Q 043369 156 WYASNQILPNGKIIVVGGRFQFTYEFI-PRTS 186 (526)
Q Consensus 156 ~y~s~~~L~dG~v~viGG~~~~~~E~y-P~~~ 186 (526)
|--++++-+.+.-|+.|..+. +.-+| -.++
T Consensus 153 WVr~vavdP~n~wf~tgs~Dr-tikIwDlatg 183 (460)
T KOG0285|consen 153 WVRSVAVDPGNEWFATGSADR-TIKIWDLATG 183 (460)
T ss_pred eEEEEeeCCCceeEEecCCCc-eeEEEEcccC
Confidence 444566666667777666553 45555 4443
No 135
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=29.60 E-value=2.9e+02 Score=30.04 Aligned_cols=95 Identities=14% Similarity=0.189 Sum_probs=50.0
Q ss_pred cCcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCc----cccccceEEeCC-CcEEEEcCcCC
Q 043369 285 VHSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPL----NRVMGDMILLPT-GDVLIINGAAK 358 (526)
Q Consensus 285 ~~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~----~R~~~~~vvLpd-G~V~vvGG~~~ 358 (526)
.+++||+.... ..+..+|+.+....|+.. .... +......+.+.+ ++||+....
T Consensus 60 ~~g~vy~~~~~------------------g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~~~~~V~v~~~~-- 119 (488)
T cd00216 60 VDGDMYFTTSH------------------SALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYWDPRKVFFGTFD-- 119 (488)
T ss_pred ECCEEEEeCCC------------------CcEEEEECCCChhhceeCCCCCccccccccccCCcEEccCCeEEEecCC--
Confidence 47888886432 135678876656779864 2221 111111233446 888874321
Q ss_pred CCCCccCCCCCccccEEEeCCCC--cEeecCCCCccccc-cccceecCCCEEEEec
Q 043369 359 GTAGWGAAREPVLNPVIYCPKIN--RFRILSPSLIPRLY-HSTAHLLSDGRVLVGG 411 (526)
Q Consensus 359 g~~g~~~~~~~~~~~e~YDP~t~--~Wt~~a~~~~~R~y-hs~a~LlpdG~V~v~G 411 (526)
| .+..+|+++. .|+.-........+ ...+..+-+++||+..
T Consensus 120 g------------~v~AlD~~TG~~~W~~~~~~~~~~~~~i~ssP~v~~~~v~vg~ 163 (488)
T cd00216 120 G------------RLVALDAETGKQVWKFGNNDQVPPGYTMTGAPTIVKKLVIIGS 163 (488)
T ss_pred C------------eEEEEECCCCCEeeeecCCCCcCcceEecCCCEEECCEEEEec
Confidence 1 4678898877 68764432211111 1222233478877653
No 136
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=28.98 E-value=7.2e+02 Score=26.36 Aligned_cols=70 Identities=14% Similarity=0.169 Sum_probs=36.2
Q ss_pred ceecccCcccc-ccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCC-CCc-cccccccceecCC
Q 043369 328 WEMEEMPLNRV-MGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSP-SLI-PRLYHSTAHLLSD 404 (526)
Q Consensus 328 W~~~~M~~~R~-~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~-~~~-~R~yhs~a~Llpd 404 (526)
|+..+++..+. ..+.+...|+.++++|... . +..-...-.+|+.... -.+ .-+| . .....+
T Consensus 318 f~~~~~~~~~~~l~~v~~~~d~~~~a~G~~G--~------------v~~s~D~G~tW~~~~~~~~~~~~ly-~-v~f~~~ 381 (398)
T PLN00033 318 FEEADIKSRGFGILDVGYRSKKEAWAAGGSG--I------------LLRSTDGGKSWKRDKGADNIAANLY-S-VKFFDD 381 (398)
T ss_pred eeecccCCCCcceEEEEEcCCCcEEEEECCC--c------------EEEeCCCCcceeEccccCCCCccee-E-EEEcCC
Confidence 33334443333 2333345688999988742 1 1222233448988652 222 2233 2 222567
Q ss_pred CEEEEecCC
Q 043369 405 GRVLVGGSN 413 (526)
Q Consensus 405 G~V~v~GG~ 413 (526)
++.|+.|-+
T Consensus 382 ~~g~~~G~~ 390 (398)
T PLN00033 382 KKGFVLGND 390 (398)
T ss_pred CceEEEeCC
Confidence 899998863
No 137
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=28.56 E-value=2.9e+02 Score=31.41 Aligned_cols=88 Identities=11% Similarity=0.071 Sum_probs=50.1
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCccccc-ceeEEec
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWY-ASNQILP 164 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y-~s~~~L~ 164 (526)
.+.+||..++.-..+-..|..--.+-++-++|+.++.|+.. ..+.+||-. +.+=. ..|.....- .++.--.
T Consensus 558 tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~LaSg~ed---~~I~iWDl~-~~~~v----~~l~~Ht~ti~SlsFS~ 629 (707)
T KOG0263|consen 558 TVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYLASGDED---GLIKIWDLA-NGSLV----KQLKGHTGTIYSLSFSR 629 (707)
T ss_pred eEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceEeecccC---CcEEEEEcC-CCcch----hhhhcccCceeEEEEec
Confidence 56778888776554433332222223445699999999863 468888876 43221 122222211 1222223
Q ss_pred CCcEEEEcCccCCeEEEE
Q 043369 165 NGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 165 dG~v~viGG~~~~~~E~y 182 (526)
||.|+|+||.++ ++.+|
T Consensus 630 dg~vLasgg~Dn-sV~lW 646 (707)
T KOG0263|consen 630 DGNVLASGGADN-SVRLW 646 (707)
T ss_pred CCCEEEecCCCC-eEEEE
Confidence 999999999875 34444
No 138
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=27.97 E-value=5.6e+02 Score=26.15 Aligned_cols=86 Identities=20% Similarity=0.235 Sum_probs=52.7
Q ss_pred ceEEEEeCCCCcEEeC-cc-CCccccccceEcCCCcEEEEcCCC--CCccEEEEEcCCCCCCcccccCCCCCc-ccccce
Q 043369 85 AHAVEFDPITRKVRPL-TI-QTDTWCSSGALLANGVLVQTGGYR--LGERVVRYLKPCSDCDWEEDHQNGLIS-PRWYAS 159 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~-~~-~~~~fc~~~~~l~~G~l~v~GG~~--~g~~~v~~ydp~~t~~W~~~~~~~m~~-~R~y~s 159 (526)
.+..+||+.+++-... .. ....|...+++.+||+++.+==.+ .+.-.+-+||.. ...... .+.+. .-.-|-
T Consensus 28 ~~~~v~D~~~g~~~~~~~a~~gRHFyGHg~fs~dG~~LytTEnd~~~g~G~IgVyd~~--~~~~ri--~E~~s~GIGPHe 103 (305)
T PF07433_consen 28 TFALVFDCRTGQLLQRLWAPPGRHFYGHGVFSPDGRLLYTTENDYETGRGVIGVYDAA--RGYRRI--GEFPSHGIGPHE 103 (305)
T ss_pred cEEEEEEcCCCceeeEEcCCCCCEEecCEEEcCCCCEEEEeccccCCCcEEEEEEECc--CCcEEE--eEecCCCcChhh
Confidence 3688999999986643 33 345688888888999877764321 233468899986 334333 22221 222344
Q ss_pred eEEecCCcEEEE--cCc
Q 043369 160 NQILPNGKIIVV--GGR 174 (526)
Q Consensus 160 ~~~L~dG~v~vi--GG~ 174 (526)
+..++||+-+|| ||.
T Consensus 104 l~l~pDG~tLvVANGGI 120 (305)
T PF07433_consen 104 LLLMPDGETLVVANGGI 120 (305)
T ss_pred EEEcCCCCEEEEEcCCC
Confidence 667889955555 563
No 139
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=27.82 E-value=2.2e+02 Score=34.35 Aligned_cols=53 Identities=25% Similarity=0.274 Sum_probs=33.1
Q ss_pred eEEEEeCCCCcEEeCccCC-----------cc--ccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCC
Q 043369 86 HAVEFDPITRKVRPLTIQT-----------DT--WCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCD 142 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~-----------~~--fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~ 142 (526)
....||+.++..+.+.... .. ...+.++..||++||+-.. .+.|+++|.. +.+
T Consensus 826 rIrviD~~tg~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVaDt~---Nn~Irvid~~-~~~ 891 (1057)
T PLN02919 826 KIKKLDPATKRVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVADTN---NSLIRYLDLN-KGE 891 (1057)
T ss_pred EEEEEECCCCeEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEEECC---CCEEEEEECC-CCc
Confidence 4677888888776543210 11 2233455578999998644 3689999987 543
No 140
>PRK04922 tolB translocation protein TolB; Provisional
Probab=26.64 E-value=7.8e+02 Score=26.01 Aligned_cols=82 Identities=12% Similarity=0.115 Sum_probs=46.6
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN 165 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d 165 (526)
....+|..+++.+.+... ...+.....-+||+.+++....++...+.++|.. +.+...+ .. ..+.....--+|
T Consensus 317 ~iy~~dl~~g~~~~lt~~-g~~~~~~~~SpDG~~Ia~~~~~~~~~~I~v~d~~-~g~~~~L--t~---~~~~~~p~~spd 389 (433)
T PRK04922 317 QIYRVAASGGSAERLTFQ-GNYNARASVSPDGKKIAMVHGSGGQYRIAVMDLS-TGSVRTL--TP---GSLDESPSFAPN 389 (433)
T ss_pred eEEEEECCCCCeEEeecC-CCCccCEEECCCCCEEEEEECCCCceeEEEEECC-CCCeEEC--CC---CCCCCCceECCC
Confidence 455667777777776532 2233345667898877765333334578899987 6666544 11 111112234568
Q ss_pred CcEEEEcCc
Q 043369 166 GKIIVVGGR 174 (526)
Q Consensus 166 G~v~viGG~ 174 (526)
|+.++....
T Consensus 390 G~~i~~~s~ 398 (433)
T PRK04922 390 GSMVLYATR 398 (433)
T ss_pred CCEEEEEEe
Confidence 887666543
No 141
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=26.47 E-value=2.7e+02 Score=29.40 Aligned_cols=81 Identities=20% Similarity=0.156 Sum_probs=50.3
Q ss_pred eEEEEeCCCCcEE-eCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCc-ccccceeEEe
Q 043369 86 HAVEFDPITRKVR-PLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLIS-PRWYASNQIL 163 (526)
Q Consensus 86 ~~~~yDp~t~~w~-~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~-~R~y~s~~~L 163 (526)
.+.+||..|++-- .+. .+++ |-+..+-.||..+++.-. .++++++||. +.+-... . |.. +---.-+.-|
T Consensus 155 ~v~iWnv~tgeali~l~-hpd~-i~S~sfn~dGs~l~Ttck---DKkvRv~dpr-~~~~v~e--~-~~heG~k~~Raifl 225 (472)
T KOG0303|consen 155 TVSIWNVGTGEALITLD-HPDM-VYSMSFNRDGSLLCTTCK---DKKVRVIDPR-RGTVVSE--G-VAHEGAKPARAIFL 225 (472)
T ss_pred eEEEEeccCCceeeecC-CCCe-EEEEEeccCCceeeeecc---cceeEEEcCC-CCcEeee--c-ccccCCCcceeEEe
Confidence 5677888887632 333 2333 444566678888887643 3899999999 6654433 1 221 1112346678
Q ss_pred cCCcEEEEcCcc
Q 043369 164 PNGKIIVVGGRF 175 (526)
Q Consensus 164 ~dG~v~viGG~~ 175 (526)
.+|+|+..|-+.
T Consensus 226 ~~g~i~tTGfsr 237 (472)
T KOG0303|consen 226 ASGKIFTTGFSR 237 (472)
T ss_pred ccCceeeecccc
Confidence 899988887643
No 142
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=26.36 E-value=7.9e+02 Score=26.39 Aligned_cols=86 Identities=9% Similarity=-0.000 Sum_probs=44.1
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEE-e-
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQI-L- 163 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~-L- 163 (526)
...+||.++.+-...-..+..--....+--||..++++-.. ..|.+||-+ ... .. ...+.+-.+..... +
T Consensus 370 ~vkiwdlks~~~~a~Fpght~~vk~i~FsENGY~Lat~add---~~V~lwDLR-Kl~--n~--kt~~l~~~~~v~s~~fD 441 (506)
T KOG0289|consen 370 VVKIWDLKSQTNVAKFPGHTGPVKAISFSENGYWLATAADD---GSVKLWDLR-KLK--NF--KTIQLDEKKEVNSLSFD 441 (506)
T ss_pred eEEEEEcCCccccccCCCCCCceeEEEeccCceEEEEEecC---CeEEEEEeh-hhc--cc--ceeeccccccceeEEEc
Confidence 46678877665211111122111223445689999998653 248999987 332 11 11222222222222 2
Q ss_pred cCCcEEEEcCccCCeEEEE
Q 043369 164 PNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 164 ~dG~v~viGG~~~~~~E~y 182 (526)
.-|+.++++|.+ +.+|
T Consensus 442 ~SGt~L~~~g~~---l~Vy 457 (506)
T KOG0289|consen 442 QSGTYLGIAGSD---LQVY 457 (506)
T ss_pred CCCCeEEeecce---eEEE
Confidence 238999999754 4455
No 143
>PF03088 Str_synth: Strictosidine synthase; InterPro: IPR018119 This entry represents a conserved region found in strictosidine synthase (4.3.3.2 from EC), a key enzyme in alkaloid biosynthesis. It catalyses the Pictet-Spengler stereospecific condensation of tryptamine with secologanin to form strictosidine []. The structure of the native enzyme from the Indian medicinal plant Rauvolfia serpentina (Serpentwood) (Devilpepper) represents the first example of a six-bladed four-stranded beta-propeller fold from the plant kingdom [].; GO: 0016844 strictosidine synthase activity, 0009058 biosynthetic process; PDB: 2FPB_A 2V91_B 2FP8_A 3V1S_B 2FPC_A 2VAQ_A 2FP9_B.
Probab=26.35 E-value=1.4e+02 Score=24.57 Aligned_cols=68 Identities=15% Similarity=0.120 Sum_probs=31.8
Q ss_pred EEecC-CeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCcccc-ccceEcCCCcEEEE
Q 043369 45 ALLPN-DRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTDTWC-SSGALLANGVLVQT 122 (526)
Q Consensus 45 a~l~~-gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc-~~~~~l~~G~l~v~ 122 (526)
.+..+ |+||+-+.+. .+.. ... ..+..+.+.....-.|||.|++.+-+.. +... .|.++-+|+.-+++
T Consensus 4 dv~~~~g~vYfTdsS~----~~~~--~~~--~~~~le~~~~GRll~ydp~t~~~~vl~~--~L~fpNGVals~d~~~vlv 73 (89)
T PF03088_consen 4 DVDQDTGTVYFTDSSS----RYDR--RDW--VYDLLEGRPTGRLLRYDPSTKETTVLLD--GLYFPNGVALSPDESFVLV 73 (89)
T ss_dssp EE-TTT--EEEEES-S----S--T--TGH--HHHHHHT---EEEEEEETTTTEEEEEEE--EESSEEEEEE-TTSSEEEE
T ss_pred eEecCCCEEEEEeCcc----ccCc--cce--eeeeecCCCCcCEEEEECCCCeEEEehh--CCCccCeEEEcCCCCEEEE
Confidence 34566 9999998864 1211 000 0001111234567889999999887642 2333 33444457774444
No 144
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=25.96 E-value=7.7e+02 Score=25.70 Aligned_cols=58 Identities=9% Similarity=-0.051 Sum_probs=35.9
Q ss_pred ceEEEEeCCCCcEE-eCccCCccc------cccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcc
Q 043369 85 AHAVEFDPITRKVR-PLTIQTDTW------CSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWE 144 (526)
Q Consensus 85 ~~~~~yDp~t~~w~-~~~~~~~~f------c~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~ 144 (526)
....+||++|.+-. .++...+++ -...++-+||+.+.+--. +....+.+.|.. +.+-.
T Consensus 77 d~V~v~D~~t~~~~~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n~-~p~~~V~VvD~~-~~kvv 141 (352)
T TIGR02658 77 DYVEVIDPQTHLPIADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQF-SPSPAVGVVDLE-GKAFV 141 (352)
T ss_pred CEEEEEECccCcEEeEEccCCCchhhccCccceEEECCCCCEEEEecC-CCCCEEEEEECC-CCcEE
Confidence 56899999998865 344333311 123456678886665433 235788889987 55543
No 145
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=25.90 E-value=3.1e+02 Score=27.91 Aligned_cols=106 Identities=17% Similarity=0.198 Sum_probs=56.3
Q ss_pred EEEEeecCCCCceecccCcccc-ccceEEeCCCcEEEEcCcCCCCCCccCCCCCccccEEEeCCCCcEeecCCCCccccc
Q 043369 317 GRLTITAQNPKWEMEEMPLNRV-MGDMILLPTGDVLIINGAAKGTAGWGAAREPVLNPVIYCPKINRFRILSPSLIPRLY 395 (526)
Q Consensus 317 ~~~d~~~~~~~W~~~~M~~~R~-~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~y 395 (526)
..||+.+ ...-+...-...|. ++..+--+||+++-.-=.+ +. .. ---+-+||-. ..++.++.-+.--+.
T Consensus 94 ~vfD~~~-~~~pv~~~s~~~RHfyGHGvfs~dG~~LYATEnd-----fd-~~--rGViGvYd~r-~~fqrvgE~~t~GiG 163 (366)
T COG3490 94 MVFDPNG-AQEPVTLVSQEGRHFYGHGVFSPDGRLLYATEND-----FD-PN--RGVIGVYDAR-EGFQRVGEFSTHGIG 163 (366)
T ss_pred EEECCCC-CcCcEEEecccCceeecccccCCCCcEEEeecCC-----CC-CC--CceEEEEecc-cccceecccccCCcC
Confidence 3577643 12222223344554 5555778999876542111 10 01 1135789987 777777665443333
Q ss_pred cccceecCCCEEEEecCC---CCCCCCcCCCCCCceeeEEEcCcc
Q 043369 396 HSTAHLLSDGRVLVGGSN---PNVNYNFSALFPTELSLQAFYPPY 437 (526)
Q Consensus 396 hs~a~LlpdG~V~v~GG~---~~~~~~~~~~~p~~~~vE~y~Ppy 437 (526)
.--.+|++|||.+|+-++ .+.++ +. +++++|.-.|.+
T Consensus 164 pHev~lm~DGrtlvvanGGIethpdf---gR--~~lNldsMePSl 203 (366)
T COG3490 164 PHEVTLMADGRTLVVANGGIETHPDF---GR--TELNLDSMEPSL 203 (366)
T ss_pred cceeEEecCCcEEEEeCCceeccccc---Cc--cccchhhcCccE
Confidence 333678899998876443 22221 11 255566666666
No 146
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=25.78 E-value=5.2e+02 Score=25.65 Aligned_cols=40 Identities=23% Similarity=0.151 Sum_probs=25.6
Q ss_pred eEEEEeCCCCcEEeC-ccCCccccc-------cceEcCCCcEEEEcCC
Q 043369 86 HAVEFDPITRKVRPL-TIQTDTWCS-------SGALLANGVLVQTGGY 125 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~-~~~~~~fc~-------~~~~l~~G~l~v~GG~ 125 (526)
.+.+||.+|.+-..+ .+..+.-|. -++...|..+++.||-
T Consensus 179 tvRvWd~kt~k~v~~ie~yk~~~~lRp~~g~wigala~~edWlvCGgG 226 (325)
T KOG0649|consen 179 TVRVWDTKTQKHVSMIEPYKNPNLLRPDWGKWIGALAVNEDWLVCGGG 226 (325)
T ss_pred cEEEEeccccceeEEeccccChhhcCcccCceeEEEeccCceEEecCC
Confidence 578899999886554 332222221 1455668899999985
No 147
>PRK02889 tolB translocation protein TolB; Provisional
Probab=25.26 E-value=8.3e+02 Score=25.82 Aligned_cols=112 Identities=16% Similarity=0.157 Sum_probs=0.0
Q ss_pred EEEEecCCeEEEEecccCCCCCccCCCCccccCccccCCCCcceEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEE
Q 043369 43 HMALLPNDRIIAFDRSHFGPSNITLPQGKCIKGVELETSDCYAHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQT 122 (526)
Q Consensus 43 ~~a~l~~gkv~~~gg~~~~~~~~~~~~g~~~~~~~~~~~~~~~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~ 122 (526)
+.+.-|||+-+++.....+ ......+|..+++.+++.. ...........+||+.+++
T Consensus 244 ~~~~SPDG~~la~~~~~~g----------------------~~~Iy~~d~~~~~~~~lt~-~~~~~~~~~wSpDG~~l~f 300 (427)
T PRK02889 244 APAWSPDGRTLAVALSRDG----------------------NSQIYTVNADGSGLRRLTQ-SSGIDTEPFFSPDGRSIYF 300 (427)
T ss_pred ceEECCCCCEEEEEEccCC----------------------CceEEEEECCCCCcEECCC-CCCCCcCeEEcCCCCEEEE
Q ss_pred cCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEcCccCCeEEEE
Q 043369 123 GGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 123 GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~y 182 (526)
.....+...+..+|.. +.....+ ............-+||+.++.........++|
T Consensus 301 ~s~~~g~~~Iy~~~~~-~g~~~~l----t~~g~~~~~~~~SpDG~~Ia~~s~~~g~~~I~ 355 (427)
T PRK02889 301 TSDRGGAPQIYRMPAS-GGAAQRV----TFTGSYNTSPRISPDGKLLAYISRVGGAFKLY 355 (427)
T ss_pred EecCCCCcEEEEEECC-CCceEEE----ecCCCCcCceEECCCCCEEEEEEccCCcEEEE
No 148
>PRK05137 tolB translocation protein TolB; Provisional
Probab=25.17 E-value=8.3e+02 Score=25.80 Aligned_cols=59 Identities=8% Similarity=-0.113 Sum_probs=37.0
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
...++|+.+++.+.+...... ......-+||+.+++....++...+.++|.. +.....+
T Consensus 227 ~i~~~dl~~g~~~~l~~~~g~-~~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~-~~~~~~L 285 (435)
T PRK05137 227 RVYLLDLETGQRELVGNFPGM-TFAPRFSPDGRKVVMSLSQGGNTDIYTMDLR-SGTTTRL 285 (435)
T ss_pred EEEEEECCCCcEEEeecCCCc-ccCcEECCCCCEEEEEEecCCCceEEEEECC-CCceEEc
Confidence 567899999888777643321 2234567899766544333445677788887 6554444
No 149
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=25.07 E-value=4.4e+02 Score=26.83 Aligned_cols=84 Identities=14% Similarity=0.180 Sum_probs=51.3
Q ss_pred ceEEEEeCCCCcEEe-Ccc-CCccccccceEcCCCcEEEE-cCCCC-CccEEEEEcCCCCCCcccccCCCCCc-ccccce
Q 043369 85 AHAVEFDPITRKVRP-LTI-QTDTWCSSGALLANGVLVQT-GGYRL-GERVVRYLKPCSDCDWEEDHQNGLIS-PRWYAS 159 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~-~~~-~~~~fc~~~~~l~~G~l~v~-GG~~~-g~~~v~~ydp~~t~~W~~~~~~~m~~-~R~y~s 159 (526)
+...+|||.+.+--. +.. ....|...+++-+||+++-. -+..+ +.-.+-+||-. ..+... .+.+. .-.-|-
T Consensus 91 tf~~vfD~~~~~~pv~~~s~~~RHfyGHGvfs~dG~~LYATEndfd~~rGViGvYd~r--~~fqrv--gE~~t~GiGpHe 166 (366)
T COG3490 91 TFAMVFDPNGAQEPVTLVSQEGRHFYGHGVFSPDGRLLYATENDFDPNRGVIGVYDAR--EGFQRV--GEFSTHGIGPHE 166 (366)
T ss_pred ceEEEECCCCCcCcEEEecccCceeecccccCCCCcEEEeecCCCCCCCceEEEEecc--ccccee--cccccCCcCcce
Confidence 456788987765332 222 34568888899999987654 22223 23467789874 444443 23221 223456
Q ss_pred eEEecCCcEEEEc
Q 043369 160 NQILPNGKIIVVG 172 (526)
Q Consensus 160 ~~~L~dG~v~viG 172 (526)
+..+.||+.+|+-
T Consensus 167 v~lm~DGrtlvva 179 (366)
T COG3490 167 VTLMADGRTLVVA 179 (366)
T ss_pred eEEecCCcEEEEe
Confidence 7788899988874
No 150
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=25.07 E-value=3.6e+02 Score=28.65 Aligned_cols=88 Identities=15% Similarity=-0.006 Sum_probs=48.5
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEe--
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQIL-- 163 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L-- 163 (526)
...+||..|++-.-.-..|-.---+....+||..+++||.+ +.++++|-. ..+ ++ ..|+.-+---+-+..
T Consensus 326 ~~RvWDlRtgr~im~L~gH~k~I~~V~fsPNGy~lATgs~D---nt~kVWDLR-~r~--~l--y~ipAH~nlVS~Vk~~p 397 (459)
T KOG0272|consen 326 LGRVWDLRTGRCIMFLAGHIKEILSVAFSPNGYHLATGSSD---NTCKVWDLR-MRS--EL--YTIPAHSNLVSQVKYSP 397 (459)
T ss_pred hhheeecccCcEEEEecccccceeeEeECCCceEEeecCCC---CcEEEeeec-ccc--cc--eecccccchhhheEecc
Confidence 45679988876443211121111234567899999999874 577788875 221 12 123322221122222
Q ss_pred cCCcEEEEcCccCCeEEEE
Q 043369 164 PNGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 164 ~dG~v~viGG~~~~~~E~y 182 (526)
..|+.++..+.++ ++.+|
T Consensus 398 ~~g~fL~TasyD~-t~kiW 415 (459)
T KOG0272|consen 398 QEGYFLVTASYDN-TVKIW 415 (459)
T ss_pred cCCeEEEEcccCc-ceeee
Confidence 1578888888775 45566
No 151
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=24.78 E-value=7.6e+02 Score=25.25 Aligned_cols=103 Identities=17% Similarity=0.258 Sum_probs=55.6
Q ss_pred cCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc--cCCCCCcccccceeEEecCCcEEEEcCccCCeEEEE-cCCCCCCC
Q 043369 114 LANGVLVQTGGYRLGERVVRYLKPCSDCDWEED--HQNGLISPRWYASNQILPNGKIIVVGGRFQFTYEFI-PRTSDSDR 190 (526)
Q Consensus 114 l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~--~~~~m~~~R~y~s~~~L~dG~v~viGG~~~~~~E~y-P~~~~~~~ 190 (526)
--||..+.+||.+ +.+.+||.. +++-... |.++...-||-.+. +.-.++=|++.++..+| ++..
T Consensus 81 sddgskVf~g~~D---k~~k~wDL~-S~Q~~~v~~Hd~pvkt~~wv~~~-----~~~cl~TGSWDKTlKfWD~R~~---- 147 (347)
T KOG0647|consen 81 SDDGSKVFSGGCD---KQAKLWDLA-SGQVSQVAAHDAPVKTCHWVPGM-----NYQCLVTGSWDKTLKFWDTRSS---- 147 (347)
T ss_pred ccCCceEEeeccC---CceEEEEcc-CCCeeeeeecccceeEEEEecCC-----CcceeEecccccceeecccCCC----
Confidence 3478888888874 678899988 7765554 11233344553321 12244556677788888 6543
Q ss_pred ccee-ecCCccccCCCCCCCCCCcceEEEecCCcEEEEEccceEEEeccCCe
Q 043369 191 KILY-QLPFLKETMHSPKIPNNLYPFLHLSTDGNLFIFANDRAILLDYVNNR 241 (526)
Q Consensus 191 ~~w~-~~p~l~~~~~~~~~~~~~yp~~~~~~dG~Iy~~Gg~~~~~yDp~t~~ 241 (526)
... .+.+..+...+ ...||.+++. .++++..+|+..+..
T Consensus 148 -~pv~t~~LPeRvYa~----Dv~~pm~vVa-------ta~r~i~vynL~n~~ 187 (347)
T KOG0647|consen 148 -NPVATLQLPERVYAA----DVLYPMAVVA-------TAERHIAVYNLENPP 187 (347)
T ss_pred -Ceeeeeeccceeeeh----hccCceeEEE-------ecCCcEEEEEcCCCc
Confidence 221 22221121111 2456655443 345666678876554
No 152
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=24.54 E-value=7.1e+02 Score=24.77 Aligned_cols=84 Identities=21% Similarity=0.168 Sum_probs=42.3
Q ss_pred eEEEEeCCCCcEEeCccC-CccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc-----cCCCCC--ccccc
Q 043369 86 HAVEFDPITRKVRPLTIQ-TDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED-----HQNGLI--SPRWY 157 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~-~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~-----~~~~m~--~~R~y 157 (526)
....+|.++++.+..-.. +|-...-..--.++.|+ .|+. || +++++|.+ +.+-... ++..+. ..||-
T Consensus 137 ~~y~~dlE~G~i~r~~rGHtDYvH~vv~R~~~~qil-sG~E-DG--tvRvWd~k-t~k~v~~ie~yk~~~~lRp~~g~wi 211 (325)
T KOG0649|consen 137 VIYQVDLEDGRIQREYRGHTDYVHSVVGRNANGQIL-SGAE-DG--TVRVWDTK-TQKHVSMIEPYKNPNLLRPDWGKWI 211 (325)
T ss_pred EEEEEEecCCEEEEEEcCCcceeeeeeecccCccee-ecCC-Cc--cEEEEecc-ccceeEEeccccChhhcCcccCcee
Confidence 356789999988754322 23221111112345554 4554 43 57777776 4443322 111122 45664
Q ss_pred ceeEEecCCcEEEEcCccC
Q 043369 158 ASNQILPNGKIIVVGGRFQ 176 (526)
Q Consensus 158 ~s~~~L~dG~v~viGG~~~ 176 (526)
.+.+ . |-.-+|.||-..
T Consensus 212 gala-~-~edWlvCGgGp~ 228 (325)
T KOG0649|consen 212 GALA-V-NEDWLVCGGGPK 228 (325)
T ss_pred EEEe-c-cCceEEecCCCc
Confidence 4333 3 667888888543
No 153
>KOG1427 consensus Uncharacterized conserved protein, contains RCC1 domain [Function unknown]
Probab=23.76 E-value=1.4e+02 Score=30.40 Aligned_cols=89 Identities=13% Similarity=0.115 Sum_probs=53.7
Q ss_pred cccceecCCCEEEEecCCCCCCCCcCCCCCCceeeEEEcCcccCCCCCCCCCeeeecCCCCccceecCCeEEEEEEeccC
Q 043369 396 HSTAHLLSDGRVLVGGSNPNVNYNFSALFPTELSLQAFYPPYFNLMSNRSRPSISTVKPGAFLKLKYTENFLLGFKLRSG 475 (526)
Q Consensus 396 hs~a~LlpdG~V~v~GG~~~~~~~~~~~~p~~~~vE~y~Ppyl~~~~~~~RP~i~~~~p~~~~~~~~g~~~~v~~~~~~~ 475 (526)
|-+.+|..+|.||..|=|..+.+... ....|+|+||-..-- -|.| ..|.-|..|+|-++...
T Consensus 120 nHTl~ltdtG~v~afGeNK~GQlGlg-----n~~~~v~s~~~~~~~----~~~v--------~~v~cga~ftv~l~~~~- 181 (443)
T KOG1427|consen 120 NHTLVLTDTGQVLAFGENKYGQLGLG-----NAKNEVESTPLPCVV----SDEV--------TNVACGADFTVWLSSTE- 181 (443)
T ss_pred CcEEEEecCCcEEEeccccccccccc-----ccccccccCCCcccc----Cccc--------eeeccccceEEEeeccc-
Confidence 44566778999999999877665332 123488888876421 2222 44567899999887532
Q ss_pred CcceEEEEEeecCcccccC----CCCcceeecC
Q 043369 476 DLGEIFVTMVAPSFTTHSF----AMNQRLLVLE 504 (526)
Q Consensus 476 ~~~~~~v~l~~~~~~THs~----n~~QR~v~L~ 504 (526)
++..+-|-..|---|.. ||+.-.|.|.
T Consensus 182 --si~t~glp~ygqlgh~td~~~~~~~~~~~~~ 212 (443)
T KOG1427|consen 182 --SILTAGLPQYGQLGHGTDNEFNMKDSSVRLA 212 (443)
T ss_pred --ceeecCCccccccccCcchhhccccccceee
Confidence 45555555555555543 3444444443
No 154
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=23.00 E-value=2.7e+02 Score=28.35 Aligned_cols=81 Identities=19% Similarity=0.134 Sum_probs=0.0
Q ss_pred EEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCccCCCC
Q 043369 290 LICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWGAARE 368 (526)
Q Consensus 290 ~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~~~~~ 368 (526)
+|.||-+ .++..+|++ ++-... .+...+.+.-.+ .|.++|+|+.+.
T Consensus 109 vIsgsWD-----------------~~ik~wD~R---~~~~~~~~d~~kkVy~~~v---~g~~LvVg~~~r---------- 155 (323)
T KOG1036|consen 109 VISGSWD-----------------KTIKFWDPR---NKVVVGTFDQGKKVYCMDV---SGNRLVVGTSDR---------- 155 (323)
T ss_pred EEEcccC-----------------ccEEEEecc---ccccccccccCceEEEEec---cCCEEEEeecCc----------
Q ss_pred CccccEEEeCCCC-------------cEeecCCCCccccccccceecCCCEEEE
Q 043369 369 PVLNPVIYCPKIN-------------RFRILSPSLIPRLYHSTAHLLSDGRVLV 409 (526)
Q Consensus 369 ~~~~~e~YDP~t~-------------~Wt~~a~~~~~R~yhs~a~LlpdG~V~v 409 (526)
.+.+||-.+. +=..++-.+..-.|...++ ||||.|
T Consensus 156 ---~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSi---eGRVav 203 (323)
T KOG1036|consen 156 ---KVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGEGYVVSSI---EGRVAV 203 (323)
T ss_pred ---eEEEEEcccccchhhhccccceeEEEEEEEecCCCceEEEee---cceEEE
No 155
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=22.94 E-value=5.8e+02 Score=25.97 Aligned_cols=56 Identities=16% Similarity=0.093 Sum_probs=33.8
Q ss_pred ceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecC---CcEEEEcCc
Q 043369 111 GALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPN---GKIIVVGGR 174 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~d---G~v~viGG~ 174 (526)
.++-.+|.+++..... ...+.+|+|. .. .. .....|+.+++.+++.+ ..+||..-+
T Consensus 218 ~~vDadG~lw~~a~~~--g~~v~~~~pd-G~---l~--~~i~lP~~~~t~~~FgG~~~~~L~iTs~~ 276 (307)
T COG3386 218 MAVDADGNLWVAAVWG--GGRVVRFNPD-GK---LL--GEIKLPVKRPTNPAFGGPDLNTLYITSAR 276 (307)
T ss_pred eEEeCCCCEEEecccC--CceEEEECCC-Cc---EE--EEEECCCCCCccceEeCCCcCEEEEEecC
Confidence 4556789999754431 2478999997 33 32 22333445677777754 566666543
No 156
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=22.84 E-value=8.3e+02 Score=24.97 Aligned_cols=40 Identities=23% Similarity=0.437 Sum_probs=24.4
Q ss_pred CCcEEEEEcc---ceEEEeccCCeEEEeccCCCCCCCCccCCCCceee
Q 043369 221 DGNLFIFAND---RAILLDYVNNRVMKNYPVMPGGISRNYPSTGSSVL 265 (526)
Q Consensus 221 dG~Iy~~Gg~---~~~~yDp~t~~w~~~~p~~p~~~~r~y~~~g~~v~ 265 (526)
++.+.+|+-+ -..+||+.+++-.+.+.. |.+ |.| .|.++.
T Consensus 16 ~~~avafaRRPG~~~~v~D~~~g~~~~~~~a-~~g--RHF--yGHg~f 58 (305)
T PF07433_consen 16 RPEAVAFARRPGTFALVFDCRTGQLLQRLWA-PPG--RHF--YGHGVF 58 (305)
T ss_pred CCeEEEEEeCCCcEEEEEEcCCCceeeEEcC-CCC--CEE--ecCEEE
Confidence 5666667743 467899999886544543 332 554 355554
No 157
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=22.45 E-value=6.8e+02 Score=27.42 Aligned_cols=97 Identities=18% Similarity=0.169 Sum_probs=53.4
Q ss_pred CcEEEEEcCCCCCCCchhhhhhcccccccceEEEEeecCCCCceec-ccCccccccceEEeCCCcEEEEcCcCCCCCCcc
Q 043369 286 HSQVLICGGTLPDSNENAAEAQIFLPAAKSCGRLTITAQNPKWEME-EMPLNRVMGDMILLPTGDVLIINGAAKGTAGWG 364 (526)
Q Consensus 286 ~gkI~v~GG~~~~~~~~~~~~~~~~~a~~s~~~~d~~~~~~~W~~~-~M~~~R~~~~~vvLpdG~V~vvGG~~~g~~g~~ 364 (526)
+|+-+++||.. .++.++|+..++..-..+ +-..+-+++- .+-||-+|...-=.+ |
T Consensus 476 dgrtLivGGea-----------------stlsiWDLAapTprikaeltssapaCyAL-a~spDakvcFsccsd-G----- 531 (705)
T KOG0639|consen 476 DGRTLIVGGEA-----------------STLSIWDLAAPTPRIKAELTSSAPACYAL-AISPDAKVCFSCCSD-G----- 531 (705)
T ss_pred CCceEEecccc-----------------ceeeeeeccCCCcchhhhcCCcchhhhhh-hcCCccceeeeeccC-C-----
Confidence 89999999963 245678887655554443 3333444443 345688876643211 1
Q ss_pred CCCCCccccEEEeCCCCcEeecCCCCccccccccceecCCCEEEEecCCCC
Q 043369 365 AAREPVLNPVIYCPKINRFRILSPSLIPRLYHSTAHLLSDGRVLVGGSNPN 415 (526)
Q Consensus 365 ~~~~~~~~~e~YDP~t~~Wt~~a~~~~~R~yhs~a~LlpdG~V~v~GG~~~ 415 (526)
.+.+||-....- +...+----..|+-.+-+||.=+=.||-.+
T Consensus 532 -------nI~vwDLhnq~~--VrqfqGhtDGascIdis~dGtklWTGGlDn 573 (705)
T KOG0639|consen 532 -------NIAVWDLHNQTL--VRQFQGHTDGASCIDISKDGTKLWTGGLDN 573 (705)
T ss_pred -------cEEEEEccccee--eecccCCCCCceeEEecCCCceeecCCCcc
Confidence 357788766522 111111112234445556787777777543
No 158
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=22.40 E-value=3e+02 Score=28.73 Aligned_cols=52 Identities=12% Similarity=0.163 Sum_probs=36.9
Q ss_pred EEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCC
Q 043369 87 AVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCD 142 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~ 142 (526)
..+|....+...++-.-++..|..+-+++||+-++.|=. + -+++++||+ +++
T Consensus 172 vWmw~ip~~~~~kv~~Gh~~~ct~G~f~pdGKr~~tgy~-d--gti~~Wn~k-tg~ 223 (399)
T KOG0296|consen 172 VWMWQIPSQALCKVMSGHNSPCTCGEFIPDGKRILTGYD-D--GTIIVWNPK-TGQ 223 (399)
T ss_pred EEEEECCCcceeeEecCCCCCcccccccCCCceEEEEec-C--ceEEEEecC-CCc
Confidence 445555444444444457888999999999999998754 3 478999998 663
No 159
>PRK01029 tolB translocation protein TolB; Provisional
Probab=21.70 E-value=9.8e+02 Score=25.40 Aligned_cols=57 Identities=12% Similarity=-0.056 Sum_probs=33.9
Q ss_pred ceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCCcccccceeEEecCCcEEEEc
Q 043369 111 GALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLISPRWYASNQILPNGKIIVVG 172 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~~~R~y~s~~~L~dG~v~viG 172 (526)
...-+||+.+++-...++...+.+||+. +.+...+ ..- .+......--+||+.+++-
T Consensus 332 p~wSPDG~~Laf~~~~~g~~~I~v~dl~-~g~~~~L--t~~--~~~~~~p~wSpDG~~L~f~ 388 (428)
T PRK01029 332 PAWSPDGKKIAFCSVIKGVRQICVYDLA-TGRDYQL--TTS--PENKESPSWAIDSLHLVYS 388 (428)
T ss_pred eeECCCCCEEEEEEcCCCCcEEEEEECC-CCCeEEc--cCC--CCCccceEECCCCCEEEEE
Confidence 4567899877765544455689999998 7766555 111 1212223334688765543
No 160
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=21.37 E-value=1.1e+02 Score=19.67 Aligned_cols=23 Identities=17% Similarity=0.254 Sum_probs=16.1
Q ss_pred ceEcCCCcEEEEcCCCCCccEEEEEc
Q 043369 111 GALLANGVLVQTGGYRLGERVVRYLK 136 (526)
Q Consensus 111 ~~~l~~G~l~v~GG~~~g~~~v~~yd 136 (526)
....+++..+++||.+ +.+++||
T Consensus 17 i~~~~~~~~~~s~~~D---~~i~vwd 39 (39)
T PF00400_consen 17 IAWSPDGNFLASGSSD---GTIRVWD 39 (39)
T ss_dssp EEEETTSSEEEEEETT---SEEEEEE
T ss_pred EEEecccccceeeCCC---CEEEEEC
Confidence 4455678888888864 5677775
No 161
>PRK01029 tolB translocation protein TolB; Provisional
Probab=21.32 E-value=4.3e+02 Score=28.19 Aligned_cols=60 Identities=10% Similarity=-0.045 Sum_probs=37.3
Q ss_pred ceEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 85 AHAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 85 ~~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
....+||+.+++.+.+... ..........+||+.+++-....+...+..+|.. +.+...+
T Consensus 351 ~~I~v~dl~~g~~~~Lt~~-~~~~~~p~wSpDG~~L~f~~~~~g~~~L~~vdl~-~g~~~~L 410 (428)
T PRK01029 351 RQICVYDLATGRDYQLTTS-PENKESPSWAIDSLHLVYSAGNSNESELYLISLI-TKKTRKI 410 (428)
T ss_pred cEEEEEECCCCCeEEccCC-CCCccceEECCCCCEEEEEECCCCCceEEEEECC-CCCEEEe
Confidence 3567889999998887643 2223345567788877654433344567777776 5555443
No 162
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=21.20 E-value=7.9e+02 Score=28.33 Aligned_cols=56 Identities=13% Similarity=0.123 Sum_probs=38.3
Q ss_pred eEEEEeCCCCcEEeCccCCccccccceEcCCCcEEEEcCCCCCccEEEEEcCCCCCCcccc
Q 043369 86 HAVEFDPITRKVRPLTIQTDTWCSSGALLANGVLVQTGGYRLGERVVRYLKPCSDCDWEED 146 (526)
Q Consensus 86 ~~~~yDp~t~~w~~~~~~~~~fc~~~~~l~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~ 146 (526)
.-.+|+.+|++-..+-..|+.--++-++-++|.+++.|-++ ++|+++|-- .+|.+.
T Consensus 459 ~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS~SWD---kTVRiW~if--~s~~~v 514 (893)
T KOG0291|consen 459 EIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLASGSWD---KTVRIWDIF--SSSGTV 514 (893)
T ss_pred EEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEecccc---ceEEEEEee--ccCcee
Confidence 45678999998777655555433334567889999998885 678877764 345444
No 163
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=21.12 E-value=1.3e+03 Score=26.42 Aligned_cols=85 Identities=8% Similarity=0.046 Sum_probs=45.7
Q ss_pred EEEEeCCCCcEEeCccC--CccccccceEc--CCCcEEEEcCCCCCccEEEEEcCCCCCCcccccCCCCC-cccccceeE
Q 043369 87 AVEFDPITRKVRPLTIQ--TDTWCSSGALL--ANGVLVQTGGYRLGERVVRYLKPCSDCDWEEDHQNGLI-SPRWYASNQ 161 (526)
Q Consensus 87 ~~~yDp~t~~w~~~~~~--~~~fc~~~~~l--~~G~l~v~GG~~~g~~~v~~ydp~~t~~W~~~~~~~m~-~~R~y~s~~ 161 (526)
+.+|++..++|.+.... +..|-+...+. .++-.+++||++ ..+-+|.+. +. .++. ..+....+|
T Consensus 37 ~~vw~~~~~~~l~~~~~~~~~g~i~~~i~y~e~~~~~l~~g~~D---~~i~v~~~~-~~-------~P~~~LkgH~snVC 105 (745)
T KOG0301|consen 37 VKVWAKKGKQYLETHAFEGPKGFIANSICYAESDKGRLVVGGMD---TTIIVFKLS-QA-------EPLYTLKGHKSNVC 105 (745)
T ss_pred eeeeeccCcccccceecccCcceeeccceeccccCcceEeeccc---ceEEEEecC-CC-------Cchhhhhcccccee
Confidence 67799988888874432 22232221222 344456778874 355577765 21 1122 123334455
Q ss_pred Eec-CCcEEEEcCccCCeEEEE
Q 043369 162 ILP-NGKIIVVGGRFQFTYEFI 182 (526)
Q Consensus 162 ~L~-dG~v~viGG~~~~~~E~y 182 (526)
.|+ +.+--++.|++..+.-+|
T Consensus 106 ~ls~~~~~~~iSgSWD~TakvW 127 (745)
T KOG0301|consen 106 SLSIGEDGTLISGSWDSTAKVW 127 (745)
T ss_pred eeecCCcCceEecccccceEEe
Confidence 554 223336888887777776
Done!