Query 014195
Match_columns 429
No_of_seqs 327 out of 2333
Neff 9.9
Searched_HMMs 46136
Date Fri Mar 29 02:46:08 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/014195.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/014195hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG4441 Proteins containing BT 100.0 1.2E-47 2.6E-52 382.4 30.3 264 91-392 302-567 (571)
2 PLN02193 nitrile-specifier pro 100.0 9.8E-44 2.1E-48 350.4 36.5 290 99-425 150-467 (470)
3 PLN02153 epithiospecifier prot 100.0 1.1E-43 2.4E-48 338.1 33.2 307 97-425 4-338 (341)
4 KOG4441 Proteins containing BT 100.0 1.2E-43 2.5E-48 353.8 28.1 279 108-424 272-553 (571)
5 PHA02713 hypothetical protein; 100.0 1.1E-43 2.3E-48 355.8 26.1 260 90-382 272-544 (557)
6 TIGR03547 muta_rot_YjhT mutatr 100.0 7.1E-41 1.5E-45 319.9 30.3 291 105-424 1-344 (346)
7 TIGR03548 mutarot_permut cycli 100.0 1.1E-40 2.5E-45 315.2 30.7 272 111-412 3-321 (323)
8 PHA02713 hypothetical protein; 100.0 1E-40 2.3E-45 334.2 28.7 262 123-405 259-523 (557)
9 PRK14131 N-acetylneuraminic ac 100.0 4.4E-40 9.6E-45 316.7 30.5 297 101-426 18-368 (376)
10 PLN02153 epithiospecifier prot 100.0 5.3E-40 1.2E-44 312.8 28.8 293 26-372 25-340 (341)
11 TIGR03547 muta_rot_YjhT mutatr 100.0 2.7E-39 5.9E-44 309.0 26.8 287 27-369 11-344 (346)
12 PLN02193 nitrile-specifier pro 100.0 2.4E-38 5.2E-43 312.2 30.6 283 23-372 165-469 (470)
13 PRK14131 N-acetylneuraminic ac 100.0 3.7E-38 8E-43 303.4 26.5 295 27-377 32-374 (376)
14 PHA03098 kelch-like protein; P 100.0 6.3E-38 1.4E-42 316.6 29.2 261 91-387 265-527 (534)
15 TIGR03548 mutarot_permut cycli 100.0 2.7E-37 5.9E-42 292.1 25.7 282 24-353 4-316 (323)
16 KOG4693 Uncharacterized conser 100.0 5.7E-37 1.2E-41 261.2 22.7 283 101-405 3-313 (392)
17 PHA02790 Kelch-like protein; P 100.0 3.9E-36 8.5E-41 297.2 28.1 210 117-378 267-477 (480)
18 KOG4693 Uncharacterized conser 100.0 5.2E-37 1.1E-41 261.4 17.2 281 15-351 12-313 (392)
19 PHA03098 kelch-like protein; P 100.0 3.4E-35 7.3E-40 296.8 27.8 247 122-405 251-498 (534)
20 PHA02790 Kelch-like protein; P 100.0 2.3E-35 5E-40 291.7 23.6 209 30-322 268-477 (480)
21 KOG1230 Protein containing rep 100.0 3.1E-31 6.8E-36 238.9 18.3 261 106-378 61-347 (521)
22 KOG4152 Host cell transcriptio 100.0 8.6E-30 1.9E-34 235.0 19.2 301 100-428 17-365 (830)
23 KOG0379 Kelch repeat-containin 100.0 2.7E-28 5.7E-33 240.1 25.8 258 106-394 55-328 (482)
24 KOG0379 Kelch repeat-containin 100.0 6.5E-27 1.4E-31 230.3 24.9 231 159-426 58-301 (482)
25 KOG1230 Protein containing rep 100.0 3.9E-27 8.4E-32 212.6 18.7 256 154-428 59-342 (521)
26 KOG4152 Host cell transcriptio 99.9 7.2E-27 1.6E-31 215.8 18.8 310 3-372 20-364 (830)
27 COG3055 Uncharacterized protei 99.9 2.5E-22 5.5E-27 179.4 22.0 287 104-412 29-367 (381)
28 COG3055 Uncharacterized protei 99.9 4.3E-20 9.2E-25 165.2 20.0 264 94-372 64-375 (381)
29 KOG2437 Muskelin [Signal trans 99.7 1.3E-17 2.8E-22 154.6 0.9 301 99-427 238-613 (723)
30 KOG2437 Muskelin [Signal trans 99.6 1.6E-17 3.6E-22 153.9 -7.7 343 21-425 258-662 (723)
31 PF13964 Kelch_6: Kelch motif 99.3 3.8E-12 8.2E-17 84.6 6.1 49 111-159 1-49 (50)
32 PF13964 Kelch_6: Kelch motif 99.3 4.4E-12 9.6E-17 84.2 6.2 50 161-212 1-50 (50)
33 PF01344 Kelch_1: Kelch motif; 99.2 3.2E-11 6.9E-16 79.0 4.4 47 111-157 1-47 (47)
34 PF01344 Kelch_1: Kelch motif; 99.0 2.3E-10 5E-15 74.9 4.3 47 161-209 1-47 (47)
35 PF13418 Kelch_4: Galactose ox 99.0 2.5E-10 5.5E-15 75.4 4.3 47 111-157 1-48 (49)
36 PF13415 Kelch_3: Galactose ox 99.0 8.3E-10 1.8E-14 72.8 5.5 49 171-220 1-49 (49)
37 PF07646 Kelch_2: Kelch motif; 99.0 1.2E-09 2.6E-14 72.0 5.7 47 111-157 1-49 (49)
38 PF13415 Kelch_3: Galactose ox 99.0 1.9E-09 4.2E-14 71.0 6.2 48 121-170 1-49 (49)
39 PF07646 Kelch_2: Kelch motif; 98.9 2.6E-09 5.7E-14 70.4 6.3 49 161-209 1-49 (49)
40 PF13418 Kelch_4: Galactose ox 98.9 2.8E-09 6.1E-14 70.3 4.6 48 161-210 1-49 (49)
41 smart00612 Kelch Kelch domain. 98.8 7.3E-09 1.6E-13 67.6 5.0 47 173-222 1-47 (47)
42 smart00612 Kelch Kelch domain. 98.7 2.5E-08 5.4E-13 65.1 5.3 47 123-172 1-47 (47)
43 PF13854 Kelch_5: Kelch motif 98.6 9.2E-08 2E-12 60.5 5.4 41 108-148 1-42 (42)
44 PF07250 Glyoxal_oxid_N: Glyox 98.6 6E-06 1.3E-10 73.4 18.6 153 139-327 47-210 (243)
45 PF07250 Glyoxal_oxid_N: Glyox 98.6 6.2E-06 1.3E-10 73.3 17.7 154 190-384 46-211 (243)
46 PLN02772 guanylate kinase 98.5 6.5E-07 1.4E-11 84.3 10.7 87 109-200 22-110 (398)
47 PLN02772 guanylate kinase 98.5 5.8E-07 1.3E-11 84.7 10.0 81 328-426 24-108 (398)
48 PF13854 Kelch_5: Kelch motif 98.4 6.8E-07 1.5E-11 56.5 4.9 40 159-199 2-41 (42)
49 TIGR01640 F_box_assoc_1 F-box 98.4 0.00014 3E-09 65.3 21.3 197 139-373 15-230 (230)
50 PRK11138 outer membrane biogen 98.2 0.0027 5.7E-08 62.0 28.7 287 28-400 64-382 (394)
51 TIGR01640 F_box_assoc_1 F-box 98.2 0.00028 6E-09 63.3 20.0 182 90-284 14-216 (230)
52 PF03089 RAG2: Recombination a 98.0 0.0021 4.5E-08 57.1 20.4 120 123-244 40-187 (337)
53 TIGR03300 assembly_YfgL outer 98.0 0.013 2.9E-07 56.6 28.7 289 27-402 59-369 (377)
54 PF03089 RAG2: Recombination a 98.0 0.00055 1.2E-08 60.7 15.8 111 173-285 39-174 (337)
55 PRK11138 outer membrane biogen 97.8 0.026 5.6E-07 55.1 26.4 233 91-400 80-341 (394)
56 PF07893 DUF1668: Protein of u 97.3 0.025 5.4E-07 53.8 18.4 129 170-329 75-221 (342)
57 TIGR03300 assembly_YfgL outer 97.0 0.34 7.3E-06 46.9 25.3 210 90-377 75-305 (377)
58 PF13360 PQQ_2: PQQ-like domai 97.0 0.24 5.2E-06 44.2 22.2 208 91-374 4-233 (238)
59 PRK13684 Ycf48-like protein; P 96.9 0.39 8.4E-06 45.6 23.4 237 98-402 74-321 (334)
60 PF07893 DUF1668: Protein of u 96.1 0.11 2.5E-06 49.3 12.7 109 90-207 86-216 (342)
61 PF12768 Rax2: Cortical protei 96.0 0.17 3.8E-06 46.4 13.1 119 176-324 2-130 (281)
62 PF12768 Rax2: Cortical protei 95.9 0.11 2.5E-06 47.6 11.3 108 138-261 16-130 (281)
63 PF13360 PQQ_2: PQQ-like domai 95.8 1.2 2.7E-05 39.5 19.7 161 50-231 4-183 (238)
64 PF08450 SGL: SMP-30/Gluconola 95.7 1.3 2.8E-05 39.9 17.4 86 121-228 11-103 (246)
65 KOG2055 WD40 repeat protein [G 94.8 1.2 2.6E-05 42.7 14.3 139 121-285 224-366 (514)
66 cd00094 HX Hemopexin-like repe 94.5 1.7 3.6E-05 37.7 13.9 48 340-403 110-167 (194)
67 TIGR03866 PQQ_ABC_repeats PQQ- 94.4 4 8.6E-05 37.3 20.5 139 35-201 2-148 (300)
68 PLN00033 photosystem II stabil 94.2 5.8 0.00013 38.6 24.7 92 97-205 117-214 (398)
69 cd00200 WD40 WD40 domain, foun 93.8 4.5 9.8E-05 36.0 21.5 64 121-201 62-126 (289)
70 PRK13684 Ycf48-like protein; P 93.5 7 0.00015 37.1 23.1 235 98-403 33-279 (334)
71 PRK11028 6-phosphogluconolacto 93.3 7.3 0.00016 36.7 24.7 95 90-200 57-158 (330)
72 TIGR03866 PQQ_ABC_repeats PQQ- 93.3 6.3 0.00014 36.0 17.9 66 123-204 2-67 (300)
73 KOG2055 WD40 repeat protein [G 93.2 2.1 4.5E-05 41.2 12.4 134 221-403 224-365 (514)
74 PF12217 End_beta_propel: Cata 93.1 6.1 0.00013 35.3 17.7 268 117-405 21-335 (367)
75 cd00200 WD40 WD40 domain, foun 92.9 6.5 0.00014 34.9 19.5 62 122-200 21-83 (289)
76 KOG0310 Conserved WD40 repeat- 91.9 13 0.00028 36.1 16.7 103 120-244 78-183 (487)
77 PRK04792 tolB translocation pr 91.6 16 0.00034 36.4 22.1 62 138-207 242-303 (448)
78 PF02191 OLF: Olfactomedin-lik 91.5 7.8 0.00017 35.0 13.8 141 121-286 30-191 (250)
79 PF08268 FBA_3: F-box associat 91.4 1.8 4E-05 34.6 8.9 82 169-259 3-87 (129)
80 COG4257 Vgb Streptogramin lyas 91.1 4.2 9.2E-05 36.7 11.2 139 52-206 171-313 (353)
81 KOG0310 Conserved WD40 repeat- 90.7 10 0.00022 36.9 13.9 175 120-352 121-302 (487)
82 cd00216 PQQ_DH Dehydrogenases 89.3 26 0.00056 35.3 26.3 114 29-152 57-191 (488)
83 PF08450 SGL: SMP-30/Gluconola 89.2 12 0.00027 33.5 13.4 170 33-227 11-200 (246)
84 PF03178 CPSF_A: CPSF A subuni 88.9 9.6 0.00021 35.8 12.9 139 172-347 42-190 (321)
85 PLN00181 protein SPA1-RELATED; 88.8 35 0.00076 36.7 18.5 58 172-244 545-605 (793)
86 KOG0291 WD40-repeat-containing 88.6 33 0.00072 35.6 17.0 102 162-285 435-551 (893)
87 PF02191 OLF: Olfactomedin-lik 88.6 18 0.0004 32.6 14.3 182 32-228 29-237 (250)
88 PRK05137 tolB translocation pr 88.4 27 0.00059 34.4 24.1 191 137-378 181-373 (435)
89 TIGR02800 propeller_TolB tol-p 88.1 27 0.00059 34.0 20.9 62 138-207 214-275 (417)
90 PF05096 Glu_cyclase_2: Glutam 87.7 2.3 5E-05 38.4 7.2 111 72-201 48-160 (264)
91 PF14870 PSII_BNR: Photosynthe 87.1 26 0.00056 32.7 20.4 238 98-402 45-294 (302)
92 PF05096 Glu_cyclase_2: Glutam 86.5 10 0.00022 34.4 10.6 96 120-231 54-149 (264)
93 PRK11028 6-phosphogluconolacto 86.5 29 0.00063 32.6 21.5 90 123-228 3-98 (330)
94 PRK04792 tolB translocation pr 86.0 39 0.00084 33.6 22.4 190 138-379 198-390 (448)
95 smart00284 OLF Olfactomedin-li 85.8 27 0.00058 31.6 16.2 140 121-283 34-193 (255)
96 cd00216 PQQ_DH Dehydrogenases 85.4 43 0.00094 33.7 23.5 107 90-204 71-191 (488)
97 PRK05137 tolB translocation pr 85.3 40 0.00087 33.2 22.5 63 138-208 226-288 (435)
98 PRK00178 tolB translocation pr 85.2 40 0.00088 33.1 22.4 183 138-373 223-408 (430)
99 PRK04922 tolB translocation pr 84.3 45 0.00097 32.9 22.9 183 138-373 228-413 (433)
100 PF10282 Lactonase: Lactonase, 84.2 39 0.00085 32.1 19.1 96 126-227 3-104 (345)
101 PF03178 CPSF_A: CPSF A subuni 84.1 23 0.0005 33.3 12.7 110 255-402 78-190 (321)
102 PRK00178 tolB translocation pr 84.0 45 0.00098 32.7 23.0 148 189-380 222-372 (430)
103 cd00094 HX Hemopexin-like repe 83.8 28 0.0006 30.1 15.1 94 117-231 12-120 (194)
104 KOG0649 WD40 repeat protein [G 83.5 32 0.0007 30.6 12.5 115 148-284 99-226 (325)
105 PF14870 PSII_BNR: Photosynthe 82.8 41 0.00089 31.4 16.7 192 146-401 4-204 (302)
106 PF09910 DUF2139: Uncharacteri 82.4 41 0.00088 31.0 19.3 162 151-347 26-220 (339)
107 PF13088 BNR_2: BNR repeat-lik 81.4 42 0.0009 30.5 18.0 222 146-399 28-275 (275)
108 TIGR02800 propeller_TolB tol-p 81.2 56 0.0012 31.8 21.6 147 189-379 213-362 (417)
109 PF08268 FBA_3: F-box associat 80.9 18 0.00038 28.8 9.1 83 120-206 4-88 (129)
110 PLN03215 ascorbic acid mannose 80.8 45 0.00097 32.1 12.9 106 253-383 189-306 (373)
111 KOG0649 WD40 repeat protein [G 79.9 44 0.00096 29.8 12.8 121 100-244 99-234 (325)
112 TIGR03075 PQQ_enz_alc_DH PQQ-d 79.1 43 0.00094 34.1 13.1 97 115-227 63-171 (527)
113 KOG0279 G protein beta subunit 78.9 51 0.0011 30.0 15.6 180 31-245 72-262 (315)
114 PRK04922 tolB translocation pr 78.5 72 0.0016 31.4 22.6 148 189-379 227-376 (433)
115 PRK03629 tolB translocation pr 78.3 73 0.0016 31.4 22.6 193 137-380 178-372 (429)
116 PLN00181 protein SPA1-RELATED; 77.8 1.1E+02 0.0023 33.1 19.5 98 122-244 545-647 (793)
117 PF06433 Me-amine-dh_H: Methyl 77.7 35 0.00076 32.2 10.9 197 33-245 47-275 (342)
118 PTZ00421 coronin; Provisional 77.3 85 0.0018 31.6 19.1 102 121-244 87-197 (493)
119 COG4946 Uncharacterized protei 76.5 82 0.0018 31.0 16.4 188 138-378 107-302 (668)
120 PRK04043 tolB translocation pr 76.4 82 0.0018 31.0 16.2 104 91-207 214-318 (419)
121 COG4257 Vgb Streptogramin lyas 76.4 62 0.0013 29.6 14.6 161 50-227 125-292 (353)
122 PF06433 Me-amine-dh_H: Methyl 75.8 73 0.0016 30.1 13.8 77 121-204 47-132 (342)
123 PF13859 BNR_3: BNR repeat-lik 75.7 71 0.0015 29.9 16.1 190 166-382 3-217 (310)
124 KOG0296 Angio-associated migra 75.4 75 0.0016 30.1 13.4 153 164-374 67-223 (399)
125 KOG0278 Serine/threonine kinas 75.2 38 0.00082 30.3 9.7 135 189-372 164-300 (334)
126 PLN00033 photosystem II stabil 75.1 86 0.0019 30.6 20.8 129 146-322 73-214 (398)
127 PRK02889 tolB translocation pr 75.1 88 0.0019 30.8 22.2 61 139-207 221-281 (427)
128 TIGR02658 TTQ_MADH_Hv methylam 74.7 81 0.0018 30.2 21.4 112 33-152 12-142 (352)
129 smart00284 OLF Olfactomedin-li 73.9 69 0.0015 29.0 13.2 179 33-227 34-241 (255)
130 PRK02889 tolB translocation pr 71.8 1.1E+02 0.0023 30.2 20.8 191 138-379 176-368 (427)
131 PF13088 BNR_2: BNR repeat-lik 71.7 65 0.0014 29.2 11.5 221 98-345 28-275 (275)
132 KOG0772 Uncharacterized conser 71.5 1.1E+02 0.0024 30.4 18.0 213 120-394 225-466 (641)
133 KOG0291 WD40-repeat-containing 71.0 1.4E+02 0.003 31.3 17.7 137 32-181 360-499 (893)
134 PF15525 DUF4652: Domain of un 71.0 64 0.0014 27.5 9.7 88 129-220 79-170 (200)
135 PF14583 Pectate_lyase22: Olig 70.7 31 0.00067 33.2 8.9 80 121-213 46-125 (386)
136 PRK03629 tolB translocation pr 68.7 1.2E+02 0.0027 29.8 23.6 186 138-374 223-409 (429)
137 KOG0289 mRNA splicing factor [ 67.8 1.2E+02 0.0027 29.4 13.0 121 164-328 350-475 (506)
138 KOG0281 Beta-TrCP (transducin 67.4 12 0.00026 34.9 5.2 180 32-245 245-428 (499)
139 PF10282 Lactonase: Lactonase, 65.6 1.3E+02 0.0027 28.7 20.0 169 164-379 146-332 (345)
140 COG1520 FOG: WD40-like repeat 65.5 1.3E+02 0.0028 28.8 21.5 215 91-351 79-307 (370)
141 KOG1332 Vesicle coat complex C 65.2 1E+02 0.0023 27.6 14.1 18 364-381 279-297 (299)
142 PLN03215 ascorbic acid mannose 64.7 1.4E+02 0.003 28.8 12.7 102 147-262 189-304 (373)
143 TIGR03075 PQQ_enz_alc_DH PQQ-d 63.4 1E+02 0.0022 31.4 11.7 60 310-376 132-196 (527)
144 PF13859 BNR_3: BNR repeat-lik 62.5 1.4E+02 0.003 28.1 16.7 184 116-325 3-216 (310)
145 COG4880 Secreted protein conta 60.8 1.7E+02 0.0037 28.6 12.7 79 114-201 379-460 (603)
146 PF09910 DUF2139: Uncharacteri 59.9 1.5E+02 0.0032 27.5 14.5 77 310-400 133-219 (339)
147 COG3823 Glutamine cyclotransfe 56.5 1.4E+02 0.003 26.2 11.2 101 164-284 48-149 (262)
148 PTZ00421 coronin; Provisional 56.5 2.3E+02 0.0049 28.6 13.8 22 34-60 138-159 (493)
149 KOG0306 WD40-repeat-containing 56.0 2.7E+02 0.0058 29.3 13.7 144 117-285 379-529 (888)
150 PF12217 End_beta_propel: Cata 56.0 1.6E+02 0.0034 26.7 14.7 114 112-230 136-258 (367)
151 KOG1036 Mitotic spindle checkp 54.1 1.8E+02 0.004 26.9 11.4 66 117-199 60-125 (323)
152 KOG0285 Pleiotropic regulator 53.3 2.1E+02 0.0045 27.2 16.9 97 32-149 161-268 (460)
153 KOG2048 WD40 repeat protein [G 52.1 2.9E+02 0.0063 28.6 22.0 248 50-351 48-311 (691)
154 PTZ00420 coronin; Provisional 51.2 3E+02 0.0064 28.4 13.8 22 34-60 138-159 (568)
155 PF13570 PQQ_3: PQQ-like domai 51.1 32 0.0007 20.7 3.7 26 165-199 15-40 (40)
156 KOG2048 WD40 repeat protein [G 50.0 3.1E+02 0.0068 28.3 19.7 40 139-179 48-88 (691)
157 KOG0299 U3 snoRNP-associated p 47.6 2.8E+02 0.0062 27.2 17.3 131 118-287 210-349 (479)
158 PF02897 Peptidase_S9_N: Proly 47.0 2.8E+02 0.0061 26.9 15.0 194 137-378 201-411 (414)
159 KOG2445 Nuclear pore complex c 45.4 2.6E+02 0.0056 26.1 10.3 122 95-220 95-245 (361)
160 PRK10115 protease 2; Provision 45.3 4E+02 0.0087 28.2 20.6 194 138-379 199-402 (686)
161 KOG4378 Nuclear protein COP1 [ 45.2 3.3E+02 0.0071 27.2 11.6 80 255-373 202-282 (673)
162 KOG1036 Mitotic spindle checkp 44.3 2.7E+02 0.0058 25.9 12.4 87 139-243 36-122 (323)
163 KOG0316 Conserved WD40 repeat- 44.2 2.4E+02 0.0051 25.3 15.6 121 139-287 40-166 (307)
164 COG1520 FOG: WD40-like repeat 43.0 3.1E+02 0.0066 26.2 21.0 91 118-227 65-159 (370)
165 KOG2321 WD40 repeat protein [G 42.4 1.5E+02 0.0032 30.0 8.3 59 171-243 145-203 (703)
166 KOG0296 Angio-associated migra 41.1 3.3E+02 0.0071 26.0 12.4 131 221-400 75-207 (399)
167 KOG0281 Beta-TrCP (transducin 39.1 1.5E+02 0.0033 27.9 7.5 101 213-353 321-422 (499)
168 KOG0646 WD40 repeat protein [G 38.9 3.9E+02 0.0085 26.3 15.2 60 115-182 85-145 (476)
169 PF08662 eIF2A: Eukaryotic tra 38.3 2.6E+02 0.0056 24.0 8.8 71 121-208 71-141 (194)
170 PRK01742 tolB translocation pr 38.2 4E+02 0.0086 26.2 22.2 76 121-207 214-289 (429)
171 PRK04043 tolB translocation pr 38.1 4E+02 0.0087 26.2 20.2 191 139-376 214-405 (419)
172 PF05262 Borrelia_P83: Borreli 37.4 2.3E+02 0.0049 28.5 8.9 87 133-227 370-456 (489)
173 PRK01742 tolB translocation pr 37.3 4.1E+02 0.0089 26.1 21.6 79 121-209 168-247 (429)
174 PF08662 eIF2A: Eukaryotic tra 37.1 2.3E+02 0.0049 24.3 8.2 55 337-402 108-162 (194)
175 KOG1898 Splicing factor 3b, su 37.0 6.2E+02 0.013 28.0 14.9 31 364-394 999-1029(1205)
176 KOG0639 Transducin-like enhanc 36.6 4.5E+02 0.0098 26.3 10.5 104 32-149 475-584 (705)
177 KOG0278 Serine/threonine kinas 35.6 3.4E+02 0.0073 24.6 10.6 55 337-405 232-289 (334)
178 PTZ00420 coronin; Provisional 35.1 5.2E+02 0.011 26.6 19.0 58 172-244 138-196 (568)
179 COG2706 3-carboxymuconate cycl 35.0 4E+02 0.0087 25.3 20.1 148 137-324 166-332 (346)
180 KOG0772 Uncharacterized conser 34.7 4.9E+02 0.011 26.2 12.3 101 123-245 180-299 (641)
181 KOG2111 Uncharacterized conser 34.7 1.2E+02 0.0026 28.2 6.1 57 121-177 58-118 (346)
182 COG4447 Uncharacterized protei 34.3 3.8E+02 0.0082 24.8 12.2 242 94-401 68-321 (339)
183 KOG2445 Nuclear pore complex c 31.3 4.4E+02 0.0096 24.6 11.2 62 316-382 149-220 (361)
184 KOG0643 Translation initiation 31.2 4.2E+02 0.009 24.3 8.8 167 49-231 74-253 (327)
185 KOG0316 Conserved WD40 repeat- 29.1 4.3E+02 0.0092 23.8 11.4 132 50-201 40-176 (307)
186 KOG0282 mRNA splicing factor [ 28.8 3.4E+02 0.0073 26.9 8.2 81 171-267 269-356 (503)
187 COG4447 Uncharacterized protei 27.7 4.9E+02 0.011 24.0 13.6 140 114-284 47-190 (339)
188 KOG0266 WD40 repeat-containing 27.4 6.2E+02 0.013 25.1 17.1 88 139-243 226-316 (456)
189 COG4946 Uncharacterized protei 25.4 6.9E+02 0.015 25.0 20.1 72 118-206 232-303 (668)
190 PF07433 DUF1513: Protein of u 25.3 5.7E+02 0.012 23.9 9.4 117 261-410 2-122 (305)
191 PF11768 DUF3312: Protein of u 24.7 3.5E+02 0.0076 27.5 7.8 78 310-404 238-320 (545)
192 KOG0263 Transcription initiati 24.6 4.6E+02 0.01 27.5 8.8 102 121-245 545-649 (707)
193 KOG1332 Vesicle coat complex C 24.3 5.3E+02 0.011 23.4 7.9 56 141-207 238-296 (299)
194 PF07734 FBA_1: F-box associat 23.1 4.3E+02 0.0093 21.8 8.2 83 168-258 2-89 (164)
195 KOG0270 WD40 repeat-containing 21.2 8E+02 0.017 24.1 11.2 91 140-244 354-448 (463)
196 PF03022 MRJP: Major royal jel 20.5 6.8E+02 0.015 23.1 11.7 98 121-226 11-125 (287)
No 1
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=100.00 E-value=1.2e-47 Score=382.39 Aligned_cols=264 Identities=20% Similarity=0.368 Sum_probs=232.5
Q ss_pred ccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe
Q 014195 91 TFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD 170 (429)
Q Consensus 91 ~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~ 170 (429)
.++.||+.++.|..+++||.+|..+++++++++||++||.+.....++++|+||+.+++|+.+++|+. +|..++++++
T Consensus 302 ~ve~yd~~~~~w~~~a~m~~~r~~~~~~~~~~~lYv~GG~~~~~~~l~~ve~YD~~~~~W~~~a~M~~--~R~~~~v~~l 379 (571)
T KOG4441|consen 302 SVECYDPKTNEWSSLAPMPSPRCRVGVAVLNGKLYVVGGYDSGSDRLSSVERYDPRTNQWTPVAPMNT--KRSDFGVAVL 379 (571)
T ss_pred eeEEecCCcCcEeecCCCCcccccccEEEECCEEEEEccccCCCcccceEEEecCCCCceeccCCccC--ccccceeEEE
Confidence 34444568889999999999999999999999999999999433346789999999999999999999 8999999999
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCC-CCccccceEeeeecC
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENR-YTPEVDHWSLAVKDG 249 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~-~~~~~~~~~~~~~~~ 249 (429)
++.||++||.++... ++++++|||.+++|+.+++|+.+|+.|++++++++||++||.++.. +..++++|
T Consensus 380 ~g~iYavGG~dg~~~---l~svE~YDp~~~~W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~Y------- 449 (571)
T KOG4441|consen 380 DGKLYAVGGFDGEKS---LNSVECYDPVTNKWTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECY------- 449 (571)
T ss_pred CCEEEEEeccccccc---cccEEEecCCCCcccccCCCCcceeeeEEEEECCEEEEEcCcCCCccccceEEEE-------
Confidence 999999999997665 8899999999999999999999999999999999999999988765 55555555
Q ss_pred CccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCC
Q 014195 250 KPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKP 328 (429)
Q Consensus 250 d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~ 328 (429)
||.+++|+..++|+..|.++++++++++||++||.++.. ....+++|| .+++|+.+++|+.+
T Consensus 450 DP~t~~W~~~~~M~~~R~~~g~a~~~~~iYvvGG~~~~~-----------------~~~~VE~ydp~~~~W~~v~~m~~~ 512 (571)
T KOG4441|consen 450 DPETNTWTLIAPMNTRRSGFGVAVLNGKIYVVGGFDGTS-----------------ALSSVERYDPETNQWTMVAPMTSP 512 (571)
T ss_pred cCCCCceeecCCcccccccceEEEECCEEEEECCccCCC-----------------ccceEEEEcCCCCceeEcccCccc
Confidence 599999999999999999999999999999999998632 244599999 99999999999999
Q ss_pred CCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceeeeeeEE
Q 014195 329 DSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGY 392 (429)
Q Consensus 329 r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~ 392 (429)
|..+++ ++++++||++||+++.. +++.++.|||++++|+...++...|...++++
T Consensus 513 rs~~g~--~~~~~~ly~vGG~~~~~-------~l~~ve~ydp~~d~W~~~~~~~~~~~~~~~~~ 567 (571)
T KOG4441|consen 513 RSAVGV--VVLGGKLYAVGGFDGNN-------NLNTVECYDPETDTWTEVTEPESGRGGAGVAV 567 (571)
T ss_pred cccccE--EEECCEEEEEecccCcc-------ccceeEEcCCCCCceeeCCCccccccCcceEE
Confidence 997654 89999999999988776 68899999999999999988555555554443
No 2
>PLN02193 nitrile-specifier protein
Probab=100.00 E-value=9.8e-44 Score=350.43 Aligned_cols=290 Identities=23% Similarity=0.329 Sum_probs=227.4
Q ss_pred CCCeEEccC---CCCCccCCcEEEECCEEEEEeccCCCC-ceeeeEEEEECCCCceeeCCCCC-CCC-ccceeeEEEeCC
Q 014195 99 ELKWEKMKA---APVPRLDGAAIQIKNLLYVFAGYGSID-YVHSHVDIYNFTDNTWGGRFDMP-REM-AHSHLGMVTDGR 172 (429)
Q Consensus 99 ~~~W~~~~~---~p~~R~~~~~~~~~~~iyv~GG~~~~~-~~~~~~~~yd~~~~~W~~~~~~~-~~~-~r~~~~~~~~~~ 172 (429)
.++|.++++ +|.||.+|++++++++|||+||..... ...+++|+||+.+++|+.++.+. .|. +|.+|+++.+++
T Consensus 150 ~~~W~~~~~~~~~P~pR~~h~~~~~~~~iyv~GG~~~~~~~~~~~v~~yD~~~~~W~~~~~~g~~P~~~~~~~~~v~~~~ 229 (470)
T PLN02193 150 LGKWIKVEQKGEGPGLRCSHGIAQVGNKIYSFGGEFTPNQPIDKHLYVFDLETRTWSISPATGDVPHLSCLGVRMVSIGS 229 (470)
T ss_pred hceEEEcccCCCCCCCccccEEEEECCEEEEECCcCCCCCCeeCcEEEEECCCCEEEeCCCCCCCCCCcccceEEEEECC
Confidence 378998876 588999999999999999999986433 34567999999999999876542 222 366889999999
Q ss_pred EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCC---CCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecC
Q 014195 173 YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPL---PVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDG 249 (429)
Q Consensus 173 ~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~---p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~ 249 (429)
+||||||.+.... ++++++||+.+++|++++++ |.+|..|++++++++|||+||.+........+ .|
T Consensus 230 ~lYvfGG~~~~~~---~ndv~~yD~~t~~W~~l~~~~~~P~~R~~h~~~~~~~~iYv~GG~~~~~~~~~~~-------~y 299 (470)
T PLN02193 230 TLYVFGGRDASRQ---YNGFYSFDTTTNEWKLLTPVEEGPTPRSFHSMAADEENVYVFGGVSATARLKTLD-------SY 299 (470)
T ss_pred EEEEECCCCCCCC---CccEEEEECCCCEEEEcCcCCCCCCCccceEEEEECCEEEEECCCCCCCCcceEE-------EE
Confidence 9999999875442 78999999999999999887 88999999999999999999987654443333 34
Q ss_pred CccccceeeccC---CCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCC
Q 014195 250 KPLEKEWRTEIP---IPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSM 325 (429)
Q Consensus 250 d~~~~~W~~~~~---~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~ 325 (429)
|+.+++|+.+++ +|..|.++++++++++||++||.++. ..+++++|| .+++|+.++++
T Consensus 300 d~~t~~W~~~~~~~~~~~~R~~~~~~~~~gkiyviGG~~g~------------------~~~dv~~yD~~t~~W~~~~~~ 361 (470)
T PLN02193 300 NIVDKKWFHCSTPGDSFSIRGGAGLEVVQGKVWVVYGFNGC------------------EVDDVHYYDPVQDKWTQVETF 361 (470)
T ss_pred ECCCCEEEeCCCCCCCCCCCCCcEEEEECCcEEEEECCCCC------------------ccCceEEEECCCCEEEEeccC
Confidence 589999998754 56677778999999999999997532 246799999 99999999764
Q ss_pred ---CCCCCCcceeEEEECCEEEEEcccCCCCCC--ccceeeeCcEEEEecCCCCeEEecc------cCcceeeeee--EE
Q 014195 326 ---PKPDSHIEFAWVLVNNSIVIVGGTTEKHPT--TKKMVLVGEIFQFNLNTLKWHVIGK------LPYRVKTTLA--GY 392 (429)
Q Consensus 326 ---~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~--~~~~~~~~~i~~yd~~~~~W~~v~~------lp~~r~~~~~--~~ 392 (429)
|.+|..+ ++++++++|||+||....... .....+++++|+||+.+++|+.+.. .|.+|..+++ ..
T Consensus 362 g~~P~~R~~~--~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~ndv~~~D~~t~~W~~~~~~~~~~~~P~~R~~~~~~~~~ 439 (470)
T PLN02193 362 GVRPSERSVF--ASAAVGKHIVIFGGEIAMDPLAHVGPGQLTDGTFALDTETLQWERLDKFGEEEETPSSRGWTASTTGT 439 (470)
T ss_pred CCCCCCccee--EEEEECCEEEEECCccCCccccccCccceeccEEEEEcCcCEEEEcccCCCCCCCCCCCccccceeeE
Confidence 7777754 458899999999998652211 1112367899999999999999864 3567765532 23
Q ss_pred EC--CEEEEEcccCCCCCCCCCCccccccEEeeee
Q 014195 393 WN--GWLYFTSGQRDKGPDDPAPRKVHGDMWRTKL 425 (429)
Q Consensus 393 ~~--~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~~ 425 (429)
++ +.|++|||..+. +++++|+|++++
T Consensus 440 ~~~~~~~~~fGG~~~~-------~~~~~D~~~~~~ 467 (470)
T PLN02193 440 IDGKKGLVMHGGKAPT-------NDRFDDLFFYGI 467 (470)
T ss_pred EcCCceEEEEcCCCCc-------cccccceEEEec
Confidence 33 459999997642 456799999875
No 3
>PLN02153 epithiospecifier protein
Probab=100.00 E-value=1.1e-43 Score=338.05 Aligned_cols=307 Identities=18% Similarity=0.283 Sum_probs=229.6
Q ss_pred ccCCCeEEccC----CCCCccCCcEEEECCEEEEEeccCCC-CceeeeEEEEECCCCceeeCCCCC-CCCc-cceeeEEE
Q 014195 97 APELKWEKMKA----APVPRLDGAAIQIKNLLYVFAGYGSI-DYVHSHVDIYNFTDNTWGGRFDMP-REMA-HSHLGMVT 169 (429)
Q Consensus 97 ~~~~~W~~~~~----~p~~R~~~~~~~~~~~iyv~GG~~~~-~~~~~~~~~yd~~~~~W~~~~~~~-~~~~-r~~~~~~~ 169 (429)
+.+..|.++.+ +|.||..|++++++++|||+||.... ....+++++||+.+++|+.+++++ .|.. +.+|++++
T Consensus 4 ~~~~~W~~~~~~~~~~P~pR~~h~~~~~~~~iyv~GG~~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~p~~~~~~~~~~~ 83 (341)
T PLN02153 4 TLQGGWIKVEQKGGKGPGPRCSHGIAVVGDKLYSFGGELKPNEHIDKDLYVFDFNTHTWSIAPANGDVPRISCLGVRMVA 83 (341)
T ss_pred ccCCeEEEecCCCCCCCCCCCcceEEEECCEEEEECCccCCCCceeCcEEEEECCCCEEEEcCccCCCCCCccCceEEEE
Confidence 35668999976 79999999999999999999998643 334578999999999999988764 3322 34788999
Q ss_pred eCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCC-----CCCCCCceEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 170 DGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPL-----PVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 170 ~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~-----p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
++++||+|||.+.... ++++++||+.+++|+.+++| |.+|..|++++++++|||+||.+..........+ .
T Consensus 84 ~~~~iyv~GG~~~~~~---~~~v~~yd~~t~~W~~~~~~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~-~ 159 (341)
T PLN02153 84 VGTKLYIFGGRDEKRE---FSDFYSYDTVKNEWTFLTKLDEEGGPEARTFHSMASDENHVYVFGGVSKGGLMKTPERF-R 159 (341)
T ss_pred ECCEEEEECCCCCCCc---cCcEEEEECCCCEEEEeccCCCCCCCCCceeeEEEEECCEEEEECCccCCCccCCCccc-c
Confidence 9999999999865443 68999999999999999877 8899999999999999999998643322111111 2
Q ss_pred eeecCCccccceeeccCCC---CCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeE
Q 014195 245 AVKDGKPLEKEWRTEIPIP---RGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWK 320 (429)
Q Consensus 245 ~~~~~d~~~~~W~~~~~~p---~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~ 320 (429)
.++.||+++++|+.++++. ..+.++++++++++|||+||....... ........++++.|| .+++|+
T Consensus 160 ~v~~yd~~~~~W~~l~~~~~~~~~r~~~~~~~~~~~iyv~GG~~~~~~~---------gG~~~~~~~~v~~yd~~~~~W~ 230 (341)
T PLN02153 160 TIEAYNIADGKWVQLPDPGENFEKRGGAGFAVVQGKIWVVYGFATSILP---------GGKSDYESNAVQFFDPASGKWT 230 (341)
T ss_pred eEEEEECCCCeEeeCCCCCCCCCCCCcceEEEECCeEEEEecccccccc---------CCccceecCceEEEEcCCCcEE
Confidence 3455679999999987653 667777889999999999997532100 000011356799999 999999
Q ss_pred EcCC---CCCCCCCcceeEEEECCEEEEEcccCCCCC--CccceeeeCcEEEEecCCCCeEEec-----ccCcceeeeee
Q 014195 321 VLPS---MPKPDSHIEFAWVLVNNSIVIVGGTTEKHP--TTKKMVLVGEIFQFNLNTLKWHVIG-----KLPYRVKTTLA 390 (429)
Q Consensus 321 ~~~~---~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~--~~~~~~~~~~i~~yd~~~~~W~~v~-----~lp~~r~~~~~ 390 (429)
.++. +|.+|..+ ++++++++||||||...... .......++++|.||+++++|+.+. ++|.++..+++
T Consensus 231 ~~~~~g~~P~~r~~~--~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~n~v~~~d~~~~~W~~~~~~~~~~~pr~~~~~~~ 308 (341)
T PLN02153 231 EVETTGAKPSARSVF--AHAVVGKYIIIFGGEVWPDLKGHLGPGTLSNEGYALDTETLVWEKLGECGEPAMPRGWTAYTT 308 (341)
T ss_pred eccccCCCCCCccee--eeEEECCEEEEECcccCCccccccccccccccEEEEEcCccEEEeccCCCCCCCCCccccccc
Confidence 9974 57777654 45889999999999753211 0111225679999999999999985 45555654433
Q ss_pred E-EEC-CEEEEEcccCCCCCCCCCCccccccEEeeee
Q 014195 391 G-YWN-GWLYFTSGQRDKGPDDPAPRKVHGDMWRTKL 425 (429)
Q Consensus 391 ~-~~~-~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~~ 425 (429)
+ +.+ ++|||+||.... .++++|+|++.+
T Consensus 309 ~~v~~~~~~~~~gG~~~~-------~~~~~~~~~~~~ 338 (341)
T PLN02153 309 ATVYGKNGLLMHGGKLPT-------NERTDDLYFYAV 338 (341)
T ss_pred cccCCcceEEEEcCcCCC-------CccccceEEEec
Confidence 3 333 589999998653 245799999864
No 4
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=100.00 E-value=1.2e-43 Score=353.82 Aligned_cols=279 Identities=19% Similarity=0.360 Sum_probs=239.0
Q ss_pred CCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeC-CCCC
Q 014195 108 APVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYG-PQCR 186 (429)
Q Consensus 108 ~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~-~~~~ 186 (429)
++.+|..... ...+.||++||........+.+++||+.+++|..+++||. +|.++++++++|+||++||.+. ...
T Consensus 272 ~~~~~t~~r~-~~~~~l~~vGG~~~~~~~~~~ve~yd~~~~~w~~~a~m~~--~r~~~~~~~~~~~lYv~GG~~~~~~~- 347 (571)
T KOG4441|consen 272 MQSPRTRPRR-SVSGKLVAVGGYNRQGQSLRSVECYDPKTNEWSSLAPMPS--PRCRVGVAVLNGKLYVVGGYDSGSDR- 347 (571)
T ss_pred ccCCCcccCc-CCCCeEEEECCCCCCCcccceeEEecCCcCcEeecCCCCc--ccccccEEEECCEEEEEccccCCCcc-
Confidence 4555544433 4578999999998755567889999999999999999998 7889999999999999999994 443
Q ss_pred CCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCC
Q 014195 187 GPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGG 266 (429)
Q Consensus 187 ~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~ 266 (429)
++++|+||+.+++|..+++|+.+|..+++++++|+||++||.++..+..++++|+ |.+++|+.+++|+..+
T Consensus 348 --l~~ve~YD~~~~~W~~~a~M~~~R~~~~v~~l~g~iYavGG~dg~~~l~svE~YD-------p~~~~W~~va~m~~~r 418 (571)
T KOG4441|consen 348 --LSSVERYDPRTNQWTPVAPMNTKRSDFGVAVLDGKLYAVGGFDGEKSLNSVECYD-------PVTNKWTPVAPMLTRR 418 (571)
T ss_pred --cceEEEecCCCCceeccCCccCccccceeEEECCEEEEEeccccccccccEEEec-------CCCCcccccCCCCcce
Confidence 8999999999999999999999999999999999999999999888887777665 9999999999999999
Q ss_pred CceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEE
Q 014195 267 PHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVI 345 (429)
Q Consensus 267 ~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v 345 (429)
.++++++++++||++||.++... .++.+++|| .+++|+.+++|+.+|..++ +++++++||+
T Consensus 419 ~~~gv~~~~g~iYi~GG~~~~~~----------------~l~sve~YDP~t~~W~~~~~M~~~R~~~g--~a~~~~~iYv 480 (571)
T KOG4441|consen 419 SGHGVAVLGGKLYIIGGGDGSSN----------------CLNSVECYDPETNTWTLIAPMNTRRSGFG--VAVLNGKIYV 480 (571)
T ss_pred eeeEEEEECCEEEEEcCcCCCcc----------------ccceEEEEcCCCCceeecCCcccccccce--EEEECCEEEE
Confidence 99999999999999999875531 467799999 9999999999999999865 5899999999
Q ss_pred EcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceeeeeeEEECCEEEEEcccCCCCCCCC-CCccccccEEeee
Q 014195 346 VGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDP-APRKVHGDMWRTK 424 (429)
Q Consensus 346 ~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~-~~~~~~~d~w~~~ 424 (429)
+||.++.. .+..++.|||++++|+.+.+|+.+|..+++++.+++||++||.+....... +-=+...|.|...
T Consensus 481 vGG~~~~~-------~~~~VE~ydp~~~~W~~v~~m~~~rs~~g~~~~~~~ly~vGG~~~~~~l~~ve~ydp~~d~W~~~ 553 (571)
T KOG4441|consen 481 VGGFDGTS-------ALSSVERYDPETNQWTMVAPMTSPRSAVGVVVLGGKLYAVGGFDGNNNLNTVECYDPETDTWTEV 553 (571)
T ss_pred ECCccCCC-------ccceEEEEcCCCCceeEcccCccccccccEEEECCEEEEEecccCccccceeEEcCCCCCceeeC
Confidence 99999843 366799999999999999999999999999999999999999776422210 0012336677643
No 5
>PHA02713 hypothetical protein; Provisional
Probab=100.00 E-value=1.1e-43 Score=355.77 Aligned_cols=260 Identities=17% Similarity=0.224 Sum_probs=219.7
Q ss_pred cccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEE
Q 014195 90 ATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVT 169 (429)
Q Consensus 90 ~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~ 169 (429)
..+++||+.+++|..+++||.+|..+++++++++|||+||.+......+++++|||.+++|..+++|+. +|..+++++
T Consensus 272 ~~v~~yd~~~~~W~~l~~mp~~r~~~~~a~l~~~IYviGG~~~~~~~~~~v~~Yd~~~n~W~~~~~m~~--~R~~~~~~~ 349 (557)
T PHA02713 272 PCILVYNINTMEYSVISTIPNHIINYASAIVDNEIIIAGGYNFNNPSLNKVYKINIENKIHVELPPMIK--NRCRFSLAV 349 (557)
T ss_pred CCEEEEeCCCCeEEECCCCCccccceEEEEECCEEEEEcCCCCCCCccceEEEEECCCCeEeeCCCCcc--hhhceeEEE
Confidence 457889999999999999999999999999999999999986433446789999999999999999988 789999999
Q ss_pred eCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCC-CCccc---------
Q 014195 170 DGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENR-YTPEV--------- 239 (429)
Q Consensus 170 ~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~-~~~~~--------- 239 (429)
++++||++||.++... .+++++|||.+++|+.+++||.+|..+++++++++||++||.+... +.+..
T Consensus 350 ~~g~IYviGG~~~~~~---~~sve~Ydp~~~~W~~~~~mp~~r~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~ 426 (557)
T PHA02713 350 IDDTIYAIGGQNGTNV---ERTIECYTMGDDKWKMLPDMPIALSSYGMCVLDQYIYIIGGRTEHIDYTSVHHMNSIDMEE 426 (557)
T ss_pred ECCEEEEECCcCCCCC---CceEEEEECCCCeEEECCCCCcccccccEEEECCEEEEEeCCCcccccccccccccccccc
Confidence 9999999999865443 6789999999999999999999999999999999999999986421 00000
Q ss_pred -cceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CC-
Q 014195 240 -DHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DE- 316 (429)
Q Consensus 240 -~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~- 316 (429)
......+++|||.+++|+.+++|+.++..+++++++++|||+||.++... ..+.+++|| .+
T Consensus 427 ~~~~~~~ve~YDP~td~W~~v~~m~~~r~~~~~~~~~~~IYv~GG~~~~~~----------------~~~~ve~Ydp~~~ 490 (557)
T PHA02713 427 DTHSSNKVIRYDTVNNIWETLPNFWTGTIRPGVVSHKDDIYVVCDIKDEKN----------------VKTCIFRYNTNTY 490 (557)
T ss_pred cccccceEEEECCCCCeEeecCCCCcccccCcEEEECCEEEEEeCCCCCCc----------------cceeEEEecCCCC
Confidence 01123467788999999999999999998999999999999999863211 223589999 77
Q ss_pred CCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccC
Q 014195 317 MKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLP 382 (429)
Q Consensus 317 ~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp 382 (429)
++|+.+++||.+|..++ +++++|+||++||+++.. ++++||+.+++|+.+.+..
T Consensus 491 ~~W~~~~~m~~~r~~~~--~~~~~~~iyv~Gg~~~~~----------~~e~yd~~~~~W~~~~~~~ 544 (557)
T PHA02713 491 NGWELITTTESRLSALH--TILHDNTIMMLHCYESYM----------LQDTFNVYTYEWNHICHQH 544 (557)
T ss_pred CCeeEccccCcccccce--eEEECCEEEEEeeeccee----------ehhhcCcccccccchhhhc
Confidence 79999999999998654 589999999999987632 7999999999999886543
No 6
>TIGR03547 muta_rot_YjhT mutatrotase, YjhT family. Members of this protein family contain multiple copies of the beta-propeller-forming Kelch repeat. All are full-length homologs to YjhT of Escherichia coli, which has been identified as a mutarotase for sialic acid. This protein improves bacterial ability to obtain host sialic acid, and thus serves as a virulence factor. Some bacteria carry what appears to be a cyclically permuted homolog of this protein.
Probab=100.00 E-value=7.1e-41 Score=319.91 Aligned_cols=291 Identities=21% Similarity=0.352 Sum_probs=219.6
Q ss_pred ccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEEC--CCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeC
Q 014195 105 MKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNF--TDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYG 182 (429)
Q Consensus 105 ~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~--~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~ 182 (429)
+++||.+|..+++++++++|||+||... +++++||+ .+++|..+++||.. +|.+++++.++++|||+||...
T Consensus 1 ~~~lp~~~~~~~~~~~~~~vyv~GG~~~-----~~~~~~d~~~~~~~W~~l~~~p~~-~R~~~~~~~~~~~iYv~GG~~~ 74 (346)
T TIGR03547 1 LPDLPVGFKNGTGAIIGDKVYVGLGSAG-----TSWYKLDLKKPSKGWQKIADFPGG-PRNQAVAAAIDGKLYVFGGIGK 74 (346)
T ss_pred CCCCCccccCceEEEECCEEEEEccccC-----CeeEEEECCCCCCCceECCCCCCC-CcccceEEEECCEEEEEeCCCC
Confidence 4688999999888899999999999743 45899996 67899999999842 6889999999999999999854
Q ss_pred CC---CCCCCceeEEEeCCCCceEeCC-CCCCCCCCceEE-EECCEEEEEeCCCCCCC---C-------ccc--------
Q 014195 183 PQ---CRGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQ-LWRGRLHVMGGSGENRY---T-------PEV-------- 239 (429)
Q Consensus 183 ~~---~~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~-~~~~~lyv~GG~~~~~~---~-------~~~-------- 239 (429)
.. ....++++|+||+.+++|+.++ ++|.+|..++++ +++++||++||.+...+ . ...
T Consensus 75 ~~~~~~~~~~~~v~~Yd~~~~~W~~~~~~~p~~~~~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 154 (346)
T TIGR03547 75 ANSEGSPQVFDDVYRYDPKKNSWQKLDTRSPVGLLGASGFSLHNGQAYFTGGVNKNIFDGYFADLSAADKDSEPKDKLIA 154 (346)
T ss_pred CCCCCcceecccEEEEECCCCEEecCCCCCCCcccceeEEEEeCCEEEEEcCcChHHHHHHHhhHhhcCccchhhhhhHH
Confidence 22 1123679999999999999997 567777777776 78999999999864211 0 000
Q ss_pred ---------cceEeeeecCCccccceeeccCCCC-CCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCc
Q 014195 240 ---------DHWSLAVKDGKPLEKEWRTEIPIPR-GGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDD 309 (429)
Q Consensus 240 ---------~~~~~~~~~~d~~~~~W~~~~~~p~-~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~ 309 (429)
..+.-.++.|||.+++|+.+++||. .+..++++.++++|||+||...... ...+
T Consensus 155 ~~~~~~~~~~~~~~~v~~YDp~t~~W~~~~~~p~~~r~~~~~~~~~~~iyv~GG~~~~~~----------------~~~~ 218 (346)
T TIGR03547 155 AYFSQPPEDYFWNKNVLSYDPSTNQWRNLGENPFLGTAGSAIVHKGNKLLLINGEIKPGL----------------RTAE 218 (346)
T ss_pred HHhCCChhHcCccceEEEEECCCCceeECccCCCCcCCCceEEEECCEEEEEeeeeCCCc----------------cchh
Confidence 0112346667799999999999985 5777888999999999999753210 1223
Q ss_pred e--EEeC-CCCCeEEcCCCCCCCCC-----cceeEEEECCEEEEEcccCCCCCC---------cc-ceeeeCcEEEEecC
Q 014195 310 V--YMLD-DEMKWKVLPSMPKPDSH-----IEFAWVLVNNSIVIVGGTTEKHPT---------TK-KMVLVGEIFQFNLN 371 (429)
Q Consensus 310 v--~~~d-~~~~W~~~~~~~~~r~~-----~~~~~~~~~~~i~v~GG~~~~~~~---------~~-~~~~~~~i~~yd~~ 371 (429)
+ |++| .+++|+.+++||.+|.. .++++++++++|||+||.+..... .. ....+..+++||++
T Consensus 219 ~~~y~~~~~~~~W~~~~~m~~~r~~~~~~~~~~~a~~~~~~Iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~e~yd~~ 298 (346)
T TIGR03547 219 VKQYLFTGGKLEWNKLPPLPPPKSSSQEGLAGAFAGISNGVLLVAGGANFPGAQENYKNGKLYAHEGLIKAWSSEVYALD 298 (346)
T ss_pred eEEEEecCCCceeeecCCCCCCCCCccccccEEeeeEECCEEEEeecCCCCCchhhhhcCCccccCCCCceeEeeEEEec
Confidence 4 5555 67899999999988632 344467899999999998642210 00 00012468999999
Q ss_pred CCCeEEecccCcceeeeeeEEECCEEEEEcccCCCCCCCCCCccccccEEeee
Q 014195 372 TLKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDPAPRKVHGDMWRTK 424 (429)
Q Consensus 372 ~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~ 424 (429)
+++|+.+++||.+|..++++.++++|||+||....+ ..++|++++-
T Consensus 299 ~~~W~~~~~lp~~~~~~~~~~~~~~iyv~GG~~~~~-------~~~~~v~~~~ 344 (346)
T TIGR03547 299 NGKWSKVGKLPQGLAYGVSVSWNNGVLLIGGENSGG-------KAVTDVYLLS 344 (346)
T ss_pred CCcccccCCCCCCceeeEEEEcCCEEEEEeccCCCC-------CEeeeEEEEE
Confidence 999999999999999999889999999999976544 2346676553
No 7
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=100.00 E-value=1.1e-40 Score=315.17 Aligned_cols=272 Identities=18% Similarity=0.214 Sum_probs=214.3
Q ss_pred CccCCcEEEECCEEEEEeccCCCC---------ceeeeEEEEE-CCC-CceeeCCCCCCCCccceeeEEEeCCEEEEEeC
Q 014195 111 PRLDGAAIQIKNLLYVFAGYGSID---------YVHSHVDIYN-FTD-NTWGGRFDMPREMAHSHLGMVTDGRYIYVVTG 179 (429)
Q Consensus 111 ~R~~~~~~~~~~~iyv~GG~~~~~---------~~~~~~~~yd-~~~-~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG 179 (429)
.++++.++++++.|||+||.+..+ ...+++++|+ +.. .+|..+++||. +|..++++.++++||++||
T Consensus 3 ~~~g~~~~~~~~~l~v~GG~~~~~~~~~~~g~~~~~~~v~~~~~~~~~~~W~~~~~lp~--~r~~~~~~~~~~~lyviGG 80 (323)
T TIGR03548 3 GVAGCYAGIIGDYILVAGGCNFPEDPLAEGGKKKNYKGIYIAKDENSNLKWVKDGQLPY--EAAYGASVSVENGIYYIGG 80 (323)
T ss_pred ceeeEeeeEECCEEEEeeccCCCCCchhhCCcEEeeeeeEEEecCCCceeEEEcccCCc--cccceEEEEECCEEEEEcC
Confidence 366788899999999999987643 2345788886 332 37999999987 6767777888999999999
Q ss_pred eeCCCCCCCCceeEEEeCCCCce----EeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccc
Q 014195 180 QYGPQCRGPTAHTFVLDTETKKW----QDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKE 255 (429)
Q Consensus 180 ~~~~~~~~~~~~~~~yd~~t~~W----~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~ 255 (429)
.++... ++++++||+.+++| +.+++||.+|..|++++++++|||+||.......+ .++.||+.+++
T Consensus 81 ~~~~~~---~~~v~~~d~~~~~w~~~~~~~~~lp~~~~~~~~~~~~~~iYv~GG~~~~~~~~-------~v~~yd~~~~~ 150 (323)
T TIGR03548 81 SNSSER---FSSVYRITLDESKEELICETIGNLPFTFENGSACYKDGTLYVGGGNRNGKPSN-------KSYLFNLETQE 150 (323)
T ss_pred CCCCCC---ceeEEEEEEcCCceeeeeeEcCCCCcCccCceEEEECCEEEEEeCcCCCccCc-------eEEEEcCCCCC
Confidence 875443 78999999999998 78899999999999999999999999975433322 23455699999
Q ss_pred eeeccCCCC-CCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCC---CCCC
Q 014195 256 WRTEIPIPR-GGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMP---KPDS 330 (429)
Q Consensus 256 W~~~~~~p~-~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~---~~r~ 330 (429)
|+.++++|. .+..+++++++++|||+||.+.. ...++++|| .+++|+.+++|+ .|+.
T Consensus 151 W~~~~~~p~~~r~~~~~~~~~~~iYv~GG~~~~------------------~~~~~~~yd~~~~~W~~~~~~~~~~~p~~ 212 (323)
T TIGR03548 151 WFELPDFPGEPRVQPVCVKLQNELYVFGGGSNI------------------AYTDGYKYSPKKNQWQKVADPTTDSEPIS 212 (323)
T ss_pred eeECCCCCCCCCCcceEEEECCEEEEEcCCCCc------------------cccceEEEecCCCeeEECCCCCCCCCcee
Confidence 999998874 67777888999999999997532 134578999 899999998763 4554
Q ss_pred Cccee-EEEECCEEEEEcccCCCCCCc-------------------------cceeeeCcEEEEecCCCCeEEecccC-c
Q 014195 331 HIEFA-WVLVNNSIVIVGGTTEKHPTT-------------------------KKMVLVGEIFQFNLNTLKWHVIGKLP-Y 383 (429)
Q Consensus 331 ~~~~~-~~~~~~~i~v~GG~~~~~~~~-------------------------~~~~~~~~i~~yd~~~~~W~~v~~lp-~ 383 (429)
.+.++ +++.+++|||+||.+.....+ ....+.+++++||+.+++|+.++++| .
T Consensus 213 ~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~yd~~~~~W~~~~~~p~~ 292 (323)
T TIGR03548 213 LLGAASIKINESLLLCIGGFNKDVYNDAVIDLATMKDESLKGYKKEYFLKPPEWYNWNRKILIYNVRTGKWKSIGNSPFF 292 (323)
T ss_pred ccceeEEEECCCEEEEECCcCHHHHHHHHhhhhhccchhhhhhHHHHhCCCccccCcCceEEEEECCCCeeeEccccccc
Confidence 43333 345579999999987431000 00013468999999999999999887 5
Q ss_pred ceeeeeeEEECCEEEEEcccCCCCCCCCC
Q 014195 384 RVKTTLAGYWNGWLYFTSGQRDKGPDDPA 412 (429)
Q Consensus 384 ~r~~~~~~~~~~~i~v~GG~~~~~~~~~~ 412 (429)
+|..++++.++++||++||...++.+|+.
T Consensus 293 ~r~~~~~~~~~~~iyv~GG~~~pg~rt~~ 321 (323)
T TIGR03548 293 ARCGAALLLTGNNIFSINGELKPGVRTPD 321 (323)
T ss_pred ccCchheEEECCEEEEEeccccCCcCCcC
Confidence 89999999999999999999999999876
No 8
>PHA02713 hypothetical protein; Provisional
Probab=100.00 E-value=1e-40 Score=334.24 Aligned_cols=262 Identities=14% Similarity=0.190 Sum_probs=207.7
Q ss_pred EEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCce
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKW 202 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W 202 (429)
.|++.||... .....+++||+.+++|..+++||. +|..+++++++++||++||.+... ...+++++||+.+++|
T Consensus 259 ~l~~~~g~~~--~~~~~v~~yd~~~~~W~~l~~mp~--~r~~~~~a~l~~~IYviGG~~~~~--~~~~~v~~Yd~~~n~W 332 (557)
T PHA02713 259 CLVCHDTKYN--VCNPCILVYNINTMEYSVISTIPN--HIINYASAIVDNEIIIAGGYNFNN--PSLNKVYKINIENKIH 332 (557)
T ss_pred EEEEecCccc--cCCCCEEEEeCCCCeEEECCCCCc--cccceEEEEECCEEEEEcCCCCCC--CccceEEEEECCCCeE
Confidence 3555555211 122468999999999999999988 677899999999999999975322 1268999999999999
Q ss_pred EeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEc
Q 014195 203 QDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIG 282 (429)
Q Consensus 203 ~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~G 282 (429)
..+++||.+|..+++++++++||++||.++.....++++| ||.+++|+..++||.++..+++++++++||++|
T Consensus 333 ~~~~~m~~~R~~~~~~~~~g~IYviGG~~~~~~~~sve~Y-------dp~~~~W~~~~~mp~~r~~~~~~~~~g~IYviG 405 (557)
T PHA02713 333 VELPPMIKNRCRFSLAVIDDTIYAIGGQNGTNVERTIECY-------TMGDDKWKMLPDMPIALSSYGMCVLDQYIYIIG 405 (557)
T ss_pred eeCCCCcchhhceeEEEECCEEEEECCcCCCCCCceEEEE-------ECCCCeEEECCCCCcccccccEEEECCEEEEEe
Confidence 9999999999999999999999999998755444444444 599999999999999999999999999999999
Q ss_pred ccCCCCCCCCCCCccc-cccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCcccee
Q 014195 283 GQEGDFMAKPGSPIFK-CSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMV 360 (429)
Q Consensus 283 G~~~~~~~~~~~~~~~-~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~ 360 (429)
|.++.....+...-.+ .........+.+++|| .+++|+.+++|+.+|..++ +++++|+||++||.++...
T Consensus 406 G~~~~~~~~~~~~~~~~~~~~~~~~~~~ve~YDP~td~W~~v~~m~~~r~~~~--~~~~~~~IYv~GG~~~~~~------ 477 (557)
T PHA02713 406 GRTEHIDYTSVHHMNSIDMEEDTHSSNKVIRYDTVNNIWETLPNFWTGTIRPG--VVSHKDDIYVVCDIKDEKN------ 477 (557)
T ss_pred CCCcccccccccccccccccccccccceEEEECCCCCeEeecCCCCcccccCc--EEEECCEEEEEeCCCCCCc------
Confidence 9864310000000000 0000011256799999 8999999999999998754 5899999999999875432
Q ss_pred eeCcEEEEecCC-CCeEEecccCcceeeeeeEEECCEEEEEcccCC
Q 014195 361 LVGEIFQFNLNT-LKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRD 405 (429)
Q Consensus 361 ~~~~i~~yd~~~-~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~ 405 (429)
..+.+++|||++ ++|+.+++||.+|..+++++++|+||++||.+.
T Consensus 478 ~~~~ve~Ydp~~~~~W~~~~~m~~~r~~~~~~~~~~~iyv~Gg~~~ 523 (557)
T PHA02713 478 VKTCIFRYNTNTYNGWELITTTESRLSALHTILHDNTIMMLHCYES 523 (557)
T ss_pred cceeEEEecCCCCCCeeEccccCcccccceeEEECCEEEEEeeecc
Confidence 234689999999 899999999999999999999999999999876
No 9
>PRK14131 N-acetylneuraminic acid mutarotase; Provisional
Probab=100.00 E-value=4.4e-40 Score=316.69 Aligned_cols=297 Identities=20% Similarity=0.294 Sum_probs=224.9
Q ss_pred CeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECC--CCceeeCCCCCCCCccceeeEEEeCCEEEEEe
Q 014195 101 KWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFT--DNTWGGRFDMPREMAHSHLGMVTDGRYIYVVT 178 (429)
Q Consensus 101 ~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~--~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~G 178 (429)
.++.+++||.+|..+++++++++|||+||... +.+++||+. +++|..++++|.+ +|.+++++.++++|||+|
T Consensus 18 ~~~~l~~lP~~~~~~~~~~~~~~iyv~gG~~~-----~~~~~~d~~~~~~~W~~l~~~p~~-~r~~~~~v~~~~~IYV~G 91 (376)
T PRK14131 18 NAEQLPDLPVPFKNGTGAIDNNTVYVGLGSAG-----TSWYKLDLNAPSKGWTKIAAFPGG-PREQAVAAFIDGKLYVFG 91 (376)
T ss_pred ecccCCCCCcCccCCeEEEECCEEEEEeCCCC-----CeEEEEECCCCCCCeEECCcCCCC-CcccceEEEECCEEEEEc
Confidence 56788999999998899999999999999743 248899986 4789999998753 688999999999999999
Q ss_pred CeeCCC---CCCCCceeEEEeCCCCceEeCCC-CCCCCCCceEEE-ECCEEEEEeCCCCCCCC-----------------
Q 014195 179 GQYGPQ---CRGPTAHTFVLDTETKKWQDLPP-LPVPRYAPATQL-WRGRLHVMGGSGENRYT----------------- 236 (429)
Q Consensus 179 G~~~~~---~~~~~~~~~~yd~~t~~W~~~~~-~p~~r~~~~~~~-~~~~lyv~GG~~~~~~~----------------- 236 (429)
|..... ....++++|+||+.+++|+.+++ +|.++..|++++ .+++||++||.....+.
T Consensus 92 G~~~~~~~~~~~~~~~v~~YD~~~n~W~~~~~~~p~~~~~~~~~~~~~~~IYv~GG~~~~~~~~~~~d~~~~~~~~~~~~ 171 (376)
T PRK14131 92 GIGKTNSEGSPQVFDDVYKYDPKTNSWQKLDTRSPVGLAGHVAVSLHNGKAYITGGVNKNIFDGYFEDLAAAGKDKTPKD 171 (376)
T ss_pred CCCCCCCCCceeEcccEEEEeCCCCEEEeCCCCCCCcccceEEEEeeCCEEEEECCCCHHHHHHHHhhhhhcccchhhhh
Confidence 986411 11236799999999999999985 467777788777 89999999997532100
Q ss_pred ----------ccccceEeeeecCCccccceeeccCCCC-CCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCee
Q 014195 237 ----------PEVDHWSLAVKDGKPLEKEWRTEIPIPR-GGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEV 305 (429)
Q Consensus 237 ----------~~~~~~~~~~~~~d~~~~~W~~~~~~p~-~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~ 305 (429)
.....+.-.++.||+.+++|+..+++|. .+.+++++.++++|||+||......
T Consensus 172 ~i~~~~~~~~~~~~~~~~~v~~YD~~t~~W~~~~~~p~~~~~~~a~v~~~~~iYv~GG~~~~~~---------------- 235 (376)
T PRK14131 172 KINDAYFDKKPEDYFFNKEVLSYDPSTNQWKNAGESPFLGTAGSAVVIKGNKLWLINGEIKPGL---------------- 235 (376)
T ss_pred hhHHHHhcCChhhcCcCceEEEEECCCCeeeECCcCCCCCCCcceEEEECCEEEEEeeeECCCc----------------
Confidence 0000122346777899999999999985 6777888999999999999743211
Q ss_pred eeCce--EEeC-CCCCeEEcCCCCCCCCC------cceeEEEECCEEEEEcccCCCCCCc----cce------eeeCcEE
Q 014195 306 VYDDV--YMLD-DEMKWKVLPSMPKPDSH------IEFAWVLVNNSIVIVGGTTEKHPTT----KKM------VLVGEIF 366 (429)
Q Consensus 306 ~~~~v--~~~d-~~~~W~~~~~~~~~r~~------~~~~~~~~~~~i~v~GG~~~~~~~~----~~~------~~~~~i~ 366 (429)
...++ ++|| .+++|+.+++||.+|.. .++.+++++++|||+||.+...... ... .....++
T Consensus 236 ~~~~~~~~~~~~~~~~W~~~~~~p~~~~~~~~~~~~~~~a~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~e 315 (376)
T PRK14131 236 RTDAVKQGKFTGNNLKWQKLPDLPPAPGGSSQEGVAGAFAGYSNGVLLVAGGANFPGARENYQNGKLYAHEGLKKSWSDE 315 (376)
T ss_pred CChhheEEEecCCCcceeecCCCCCCCcCCcCCccceEeceeECCEEEEeeccCCCCChhhhhcCCcccccCCcceeehh
Confidence 12234 4567 78999999999887742 2233577899999999987432100 000 0013578
Q ss_pred EEecCCCCeEEecccCcceeeeeeEEECCEEEEEcccCCCCCCCCCCccccccEEeeeee
Q 014195 367 QFNLNTLKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDPAPRKVHGDMWRTKLL 426 (429)
Q Consensus 367 ~yd~~~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~~~ 426 (429)
+||+++++|+.+++||.+|..++++.++++|||+||....+ +.++|+++++++
T Consensus 316 ~yd~~~~~W~~~~~lp~~r~~~~av~~~~~iyv~GG~~~~~-------~~~~~v~~~~~~ 368 (376)
T PRK14131 316 IYALVNGKWQKVGELPQGLAYGVSVSWNNGVLLIGGETAGG-------KAVSDVTLLSWD 368 (376)
T ss_pred eEEecCCcccccCcCCCCccceEEEEeCCEEEEEcCCCCCC-------cEeeeEEEEEEc
Confidence 99999999999999999999999999999999999975422 346889888765
No 10
>PLN02153 epithiospecifier protein
Probab=100.00 E-value=5.3e-40 Score=312.79 Aligned_cols=293 Identities=19% Similarity=0.265 Sum_probs=211.7
Q ss_pred HHHHHhhcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEc
Q 014195 26 ILGFALVADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKM 105 (429)
Q Consensus 26 ~~~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~ 105 (429)
.|+++++++.|||+||...... ...+.++.||+.+++|+++
T Consensus 25 ~h~~~~~~~~iyv~GG~~~~~~---------------------------------------~~~~~~~~yd~~~~~W~~~ 65 (341)
T PLN02153 25 SHGIAVVGDKLYSFGGELKPNE---------------------------------------HIDKDLYVFDFNTHTWSIA 65 (341)
T ss_pred cceEEEECCEEEEECCccCCCC---------------------------------------ceeCcEEEEECCCCEEEEc
Confidence 5788999999999999643110 0123455566678889988
Q ss_pred cCCC-CCc---cCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCC---CCccceeeEEEeCCEEEEEe
Q 014195 106 KAAP-VPR---LDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPR---EMAHSHLGMVTDGRYIYVVT 178 (429)
Q Consensus 106 ~~~p-~~R---~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~---~~~r~~~~~~~~~~~lyv~G 178 (429)
++++ .|| .+|++++++++|||+||.+.... .+++++||+.+++|+.+++|+. |.+|..|++++.+++|||+|
T Consensus 66 ~~~~~~p~~~~~~~~~~~~~~~iyv~GG~~~~~~-~~~v~~yd~~t~~W~~~~~~~~~~~p~~R~~~~~~~~~~~iyv~G 144 (341)
T PLN02153 66 PANGDVPRISCLGVRMVAVGTKLYIFGGRDEKRE-FSDFYSYDTVKNEWTFLTKLDEEGGPEARTFHSMASDENHVYVFG 144 (341)
T ss_pred CccCCCCCCccCceEEEEECCEEEEECCCCCCCc-cCcEEEEECCCCEEEEeccCCCCCCCCCceeeEEEEECCEEEEEC
Confidence 8764 344 36888999999999999876543 5679999999999999987732 44799999999999999999
Q ss_pred CeeCCCC---CCCCceeEEEeCCCCceEeCCCCC---CCCCCceEEEECCEEEEEeCCCCCCCC-ccccceEeeeecCCc
Q 014195 179 GQYGPQC---RGPTAHTFVLDTETKKWQDLPPLP---VPRYAPATQLWRGRLHVMGGSGENRYT-PEVDHWSLAVKDGKP 251 (429)
Q Consensus 179 G~~~~~~---~~~~~~~~~yd~~t~~W~~~~~~p---~~r~~~~~~~~~~~lyv~GG~~~~~~~-~~~~~~~~~~~~~d~ 251 (429)
|.+.... ...++++++||+++++|+.++++. .+|..|++++++++|||+||....... .......-.++.||+
T Consensus 145 G~~~~~~~~~~~~~~~v~~yd~~~~~W~~l~~~~~~~~~r~~~~~~~~~~~iyv~GG~~~~~~~gG~~~~~~~~v~~yd~ 224 (341)
T PLN02153 145 GVSKGGLMKTPERFRTIEAYNIADGKWVQLPDPGENFEKRGGAGFAVVQGKIWVVYGFATSILPGGKSDYESNAVQFFDP 224 (341)
T ss_pred CccCCCccCCCcccceEEEEECCCCeEeeCCCCCCCCCCCCcceEEEECCeEEEEeccccccccCCccceecCceEEEEc
Confidence 9864321 112578999999999999998654 789999999999999999997531000 000000123455679
Q ss_pred cccceeeccC---CCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCC---
Q 014195 252 LEKEWRTEIP---IPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPS--- 324 (429)
Q Consensus 252 ~~~~W~~~~~---~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~--- 324 (429)
.+++|+.+.+ +|.+|..+++++++++||||||....... .........+++|.|| .+++|+.+..
T Consensus 225 ~~~~W~~~~~~g~~P~~r~~~~~~~~~~~iyv~GG~~~~~~~--------~~~~~~~~~n~v~~~d~~~~~W~~~~~~~~ 296 (341)
T PLN02153 225 ASGKWTEVETTGAKPSARSVFAHAVVGKYIIIFGGEVWPDLK--------GHLGPGTLSNEGYALDTETLVWEKLGECGE 296 (341)
T ss_pred CCCcEEeccccCCCCCCcceeeeEEECCEEEEECcccCCccc--------cccccccccccEEEEEcCccEEEeccCCCC
Confidence 9999999764 57778888999999999999997422100 0011233567899999 9999999863
Q ss_pred CCCCCCC--cceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCC
Q 014195 325 MPKPDSH--IEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNT 372 (429)
Q Consensus 325 ~~~~r~~--~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~ 372 (429)
.+.||.+ +.++++..+++|||+||.+.... .++|++.|+..+
T Consensus 297 ~~~pr~~~~~~~~~v~~~~~~~~~gG~~~~~~------~~~~~~~~~~~~ 340 (341)
T PLN02153 297 PAMPRGWTAYTTATVYGKNGLLMHGGKLPTNE------RTDDLYFYAVNS 340 (341)
T ss_pred CCCCCccccccccccCCcceEEEEcCcCCCCc------cccceEEEeccc
Confidence 2445544 33333334458999999987643 468999998643
No 11
>TIGR03547 muta_rot_YjhT mutatrotase, YjhT family. Members of this protein family contain multiple copies of the beta-propeller-forming Kelch repeat. All are full-length homologs to YjhT of Escherichia coli, which has been identified as a mutarotase for sialic acid. This protein improves bacterial ability to obtain host sialic acid, and thus serves as a virulence factor. Some bacteria carry what appears to be a cyclically permuted homolog of this protein.
Probab=100.00 E-value=2.7e-39 Score=309.01 Aligned_cols=287 Identities=17% Similarity=0.181 Sum_probs=206.2
Q ss_pred HHHHhhcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEcc
Q 014195 27 LGFALVADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMK 106 (429)
Q Consensus 27 ~~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~ 106 (429)
+++++++++|||+||... +.+.+||+ ++.+++|.+++
T Consensus 11 ~~~~~~~~~vyv~GG~~~----~~~~~~d~---------------------------------------~~~~~~W~~l~ 47 (346)
T TIGR03547 11 GTGAIIGDKVYVGLGSAG----TSWYKLDL---------------------------------------KKPSKGWQKIA 47 (346)
T ss_pred ceEEEECCEEEEEccccC----CeeEEEEC---------------------------------------CCCCCCceECC
Confidence 457789999999999632 33445542 24677999999
Q ss_pred CCC-CCccCCcEEEECCEEEEEeccCCCC-----ceeeeEEEEECCCCceeeCCCCCCCCccceeeEE-EeCCEEEEEeC
Q 014195 107 AAP-VPRLDGAAIQIKNLLYVFAGYGSID-----YVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMV-TDGRYIYVVTG 179 (429)
Q Consensus 107 ~~p-~~R~~~~~~~~~~~iyv~GG~~~~~-----~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~-~~~~~lyv~GG 179 (429)
+|| .+|..+++++++++|||+||..... ..++++|+||+.+++|+.++. +.|.+|.+++++ +++++||++||
T Consensus 48 ~~p~~~R~~~~~~~~~~~iYv~GG~~~~~~~~~~~~~~~v~~Yd~~~~~W~~~~~-~~p~~~~~~~~~~~~~g~IYviGG 126 (346)
T TIGR03547 48 DFPGGPRNQAVAAAIDGKLYVFGGIGKANSEGSPQVFDDVYRYDPKKNSWQKLDT-RSPVGLLGASGFSLHNGQAYFTGG 126 (346)
T ss_pred CCCCCCcccceEEEECCEEEEEeCCCCCCCCCcceecccEEEEECCCCEEecCCC-CCCCcccceeEEEEeCCEEEEEcC
Confidence 999 5899999999999999999985422 246789999999999999973 334467777666 78999999999
Q ss_pred eeCCCC-------------------------------CCCCceeEEEeCCCCceEeCCCCCC-CCCCceEEEECCEEEEE
Q 014195 180 QYGPQC-------------------------------RGPTAHTFVLDTETKKWQDLPPLPV-PRYAPATQLWRGRLHVM 227 (429)
Q Consensus 180 ~~~~~~-------------------------------~~~~~~~~~yd~~t~~W~~~~~~p~-~r~~~~~~~~~~~lyv~ 227 (429)
.+.... ....+++++||+.+++|+.+++||. +|..+++++++++|||+
T Consensus 127 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~YDp~t~~W~~~~~~p~~~r~~~~~~~~~~~iyv~ 206 (346)
T TIGR03547 127 VNKNIFDGYFADLSAADKDSEPKDKLIAAYFSQPPEDYFWNKNVLSYDPSTNQWRNLGENPFLGTAGSAIVHKGNKLLLI 206 (346)
T ss_pred cChHHHHHHHhhHhhcCccchhhhhhHHHHhCCChhHcCccceEEEEECCCCceeECccCCCCcCCCceEEEECCEEEEE
Confidence 753210 0013789999999999999999996 68999999999999999
Q ss_pred eCCCCCCCCccccceEeeeecCCccccceeeccCCCCCC-------CceeEEEeCCEEEEEcccCCCCCCCCCCCccccc
Q 014195 228 GGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGG-------PHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCS 300 (429)
Q Consensus 228 GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~-------~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~ 300 (429)
||...... ...+.|. +++|+.+++|+..++||..+ ..+++++++++|||+||.+.....+.........
T Consensus 207 GG~~~~~~-~~~~~~~---y~~~~~~~~W~~~~~m~~~r~~~~~~~~~~~a~~~~~~Iyv~GG~~~~~~~~~~~~~~~~~ 282 (346)
T TIGR03547 207 NGEIKPGL-RTAEVKQ---YLFTGGKLEWNKLPPLPPPKSSSQEGLAGAFAGISNGVLLVAGGANFPGAQENYKNGKLYA 282 (346)
T ss_pred eeeeCCCc-cchheEE---EEecCCCceeeecCCCCCCCCCccccccEEeeeEECCEEEEeecCCCCCchhhhhcCCccc
Confidence 99754321 2233332 33457889999999987543 3455788999999999986321100000000000
Q ss_pred cCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEe
Q 014195 301 RRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFN 369 (429)
Q Consensus 301 ~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd 369 (429)
.........+++|| ++++|+.+++||.+|..+ ++++++++|||+||.+.... .+++|+.|.
T Consensus 283 ~~~~~~~~~~e~yd~~~~~W~~~~~lp~~~~~~--~~~~~~~~iyv~GG~~~~~~------~~~~v~~~~ 344 (346)
T TIGR03547 283 HEGLIKAWSSEVYALDNGKWSKVGKLPQGLAYG--VSVSWNNGVLLIGGENSGGK------AVTDVYLLS 344 (346)
T ss_pred cCCCCceeEeeEEEecCCcccccCCCCCCceee--EEEEcCCEEEEEeccCCCCC------EeeeEEEEE
Confidence 00000112356666 899999999999988753 45889999999999987654 577888764
No 12
>PLN02193 nitrile-specifier protein
Probab=100.00 E-value=2.4e-38 Score=312.18 Aligned_cols=283 Identities=18% Similarity=0.272 Sum_probs=214.8
Q ss_pred HHHHHHHHhhcceeeeecCCCcc--cceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCcccccccccccccCC
Q 014195 23 FVMILGFALVADFFWASSSKFTS--SYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPEL 100 (429)
Q Consensus 23 ~~~~~~~~~~~~~ly~~GG~~~~--~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~ 100 (429)
.++.|+++++++.||++||.+.. ...++ +++||+.++
T Consensus 165 pR~~h~~~~~~~~iyv~GG~~~~~~~~~~~-----------------------------------------v~~yD~~~~ 203 (470)
T PLN02193 165 LRCSHGIAQVGNKIYSFGGEFTPNQPIDKH-----------------------------------------LYVFDLETR 203 (470)
T ss_pred CccccEEEEECCEEEEECCcCCCCCCeeCc-----------------------------------------EEEEECCCC
Confidence 34578999999999999996421 12233 445555777
Q ss_pred CeEEccC---CCC-CccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCC-CCccceeeEEEeCCEEE
Q 014195 101 KWEKMKA---APV-PRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPR-EMAHSHLGMVTDGRYIY 175 (429)
Q Consensus 101 ~W~~~~~---~p~-~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~-~~~r~~~~~~~~~~~ly 175 (429)
+|+.++. +|. +|.+|++++++++|||+||.+.... ++++++||+.+++|+++++++. |.+|..|++++.+++||
T Consensus 204 ~W~~~~~~g~~P~~~~~~~~~v~~~~~lYvfGG~~~~~~-~ndv~~yD~~t~~W~~l~~~~~~P~~R~~h~~~~~~~~iY 282 (470)
T PLN02193 204 TWSISPATGDVPHLSCLGVRMVSIGSTLYVFGGRDASRQ-YNGFYSFDTTTNEWKLLTPVEEGPTPRSFHSMAADEENVY 282 (470)
T ss_pred EEEeCCCCCCCCCCcccceEEEEECCEEEEECCCCCCCC-CccEEEEECCCCEEEEcCcCCCCCCCccceEEEEECCEEE
Confidence 7887654 343 3568889999999999999876543 6789999999999999988732 44799999999999999
Q ss_pred EEeCeeCCCCCCCCceeEEEeCCCCceEeCCC---CCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcc
Q 014195 176 VVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP---LPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPL 252 (429)
Q Consensus 176 v~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~---~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~ 252 (429)
|+||.+.... ++++++||+.+++|+.+++ +|.+|..|++++++++||++||.++.. .. + ++.||+.
T Consensus 283 v~GG~~~~~~---~~~~~~yd~~t~~W~~~~~~~~~~~~R~~~~~~~~~gkiyviGG~~g~~-~~--d-----v~~yD~~ 351 (470)
T PLN02193 283 VFGGVSATAR---LKTLDSYNIVDKKWFHCSTPGDSFSIRGGAGLEVVQGKVWVVYGFNGCE-VD--D-----VHYYDPV 351 (470)
T ss_pred EECCCCCCCC---cceEEEEECCCCEEEeCCCCCCCCCCCCCcEEEEECCcEEEEECCCCCc-cC--c-----eEEEECC
Confidence 9999876443 7899999999999999874 678999999999999999999986432 12 2 3344599
Q ss_pred ccceeeccCC---CCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCC---
Q 014195 253 EKEWRTEIPI---PRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSM--- 325 (429)
Q Consensus 253 ~~~W~~~~~~---p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~--- 325 (429)
+++|+.++++ |.+|..+++++++++||||||....... .........+++|.|| .+++|+.+..+
T Consensus 352 t~~W~~~~~~g~~P~~R~~~~~~~~~~~iyv~GG~~~~~~~--------~~~~~~~~~ndv~~~D~~t~~W~~~~~~~~~ 423 (470)
T PLN02193 352 QDKWTQVETFGVRPSERSVFASAAVGKHIVIFGGEIAMDPL--------AHVGPGQLTDGTFALDTETLQWERLDKFGEE 423 (470)
T ss_pred CCEEEEeccCCCCCCCcceeEEEEECCEEEEECCccCCccc--------cccCccceeccEEEEEcCcCEEEEcccCCCC
Confidence 9999997654 7777788999999999999998642110 0111223677899999 99999998743
Q ss_pred ---CCCCCCcceeEEEEC--CEEEEEcccCCCCCCccceeeeCcEEEEecCC
Q 014195 326 ---PKPDSHIEFAWVLVN--NSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNT 372 (429)
Q Consensus 326 ---~~~r~~~~~~~~~~~--~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~ 372 (429)
|.+|..++++++.++ +.|++|||.+.... .++|+|+|++++
T Consensus 424 ~~~P~~R~~~~~~~~~~~~~~~~~~fGG~~~~~~------~~~D~~~~~~~~ 469 (470)
T PLN02193 424 EETPSSRGWTASTTGTIDGKKGLVMHGGKAPTND------RFDDLFFYGIDS 469 (470)
T ss_pred CCCCCCCccccceeeEEcCCceEEEEcCCCCccc------cccceEEEecCC
Confidence 566665544333333 45999999986554 688999998765
No 13
>PRK14131 N-acetylneuraminic acid mutarotase; Provisional
Probab=100.00 E-value=3.7e-38 Score=303.37 Aligned_cols=295 Identities=17% Similarity=0.144 Sum_probs=211.7
Q ss_pred HHHHhhcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEcc
Q 014195 27 LGFALVADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMK 106 (429)
Q Consensus 27 ~~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~ 106 (429)
+++++++++|||+||..+ +.+..||+ +..+++|.+++
T Consensus 32 ~~~~~~~~~iyv~gG~~~----~~~~~~d~---------------------------------------~~~~~~W~~l~ 68 (376)
T PRK14131 32 GTGAIDNNTVYVGLGSAG----TSWYKLDL---------------------------------------NAPSKGWTKIA 68 (376)
T ss_pred CeEEEECCEEEEEeCCCC----CeEEEEEC---------------------------------------CCCCCCeEECC
Confidence 467889999999999633 12344432 23467899999
Q ss_pred CCC-CCccCCcEEEECCEEEEEeccCC-C----CceeeeEEEEECCCCceeeCCCCCCCCccceeeEEE-eCCEEEEEeC
Q 014195 107 AAP-VPRLDGAAIQIKNLLYVFAGYGS-I----DYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVT-DGRYIYVVTG 179 (429)
Q Consensus 107 ~~p-~~R~~~~~~~~~~~iyv~GG~~~-~----~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~-~~~~lyv~GG 179 (429)
++| .+|.++++++++++|||+||... . ...++++|+||+.+++|+.++++ .|.++.+|++++ .+++||++||
T Consensus 69 ~~p~~~r~~~~~v~~~~~IYV~GG~~~~~~~~~~~~~~~v~~YD~~~n~W~~~~~~-~p~~~~~~~~~~~~~~~IYv~GG 147 (376)
T PRK14131 69 AFPGGPREQAVAAFIDGKLYVFGGIGKTNSEGSPQVFDDVYKYDPKTNSWQKLDTR-SPVGLAGHVAVSLHNGKAYITGG 147 (376)
T ss_pred cCCCCCcccceEEEECCEEEEEcCCCCCCCCCceeEcccEEEEeCCCCEEEeCCCC-CCCcccceEEEEeeCCEEEEECC
Confidence 998 58999999999999999999864 1 23467899999999999999853 234666677666 8999999999
Q ss_pred eeCCCC-------------------------------CCCCceeEEEeCCCCceEeCCCCCC-CCCCceEEEECCEEEEE
Q 014195 180 QYGPQC-------------------------------RGPTAHTFVLDTETKKWQDLPPLPV-PRYAPATQLWRGRLHVM 227 (429)
Q Consensus 180 ~~~~~~-------------------------------~~~~~~~~~yd~~t~~W~~~~~~p~-~r~~~~~~~~~~~lyv~ 227 (429)
.+.... ....+++++||+.+++|+.++++|. +|..|+++.++++|||+
T Consensus 148 ~~~~~~~~~~~d~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~v~~YD~~t~~W~~~~~~p~~~~~~~a~v~~~~~iYv~ 227 (376)
T PRK14131 148 VNKNIFDGYFEDLAAAGKDKTPKDKINDAYFDKKPEDYFFNKEVLSYDPSTNQWKNAGESPFLGTAGSAVVIKGNKLWLI 227 (376)
T ss_pred CCHHHHHHHHhhhhhcccchhhhhhhHHHHhcCChhhcCcCceEEEEECCCCeeeECCcCCCCCCCcceEEEECCEEEEE
Confidence 753200 0014789999999999999999996 78889999999999999
Q ss_pred eCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCC--------ceeEEEeCCEEEEEcccCCCCCCCCCCCcccc
Q 014195 228 GGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGP--------HRACVVVDDRLLVIGGQEGDFMAKPGSPIFKC 299 (429)
Q Consensus 228 GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~--------~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~ 299 (429)
||...... ...+.|.+ ++|+++++|+.+++||..+. ++.+++++++|||+||.+......+.....-.
T Consensus 228 GG~~~~~~-~~~~~~~~---~~~~~~~~W~~~~~~p~~~~~~~~~~~~~~~a~~~~~~iyv~GG~~~~~~~~~~~~~~~~ 303 (376)
T PRK14131 228 NGEIKPGL-RTDAVKQG---KFTGNNLKWQKLPDLPPAPGGSSQEGVAGAFAGYSNGVLLVAGGANFPGARENYQNGKLY 303 (376)
T ss_pred eeeECCCc-CChhheEE---EecCCCcceeecCCCCCCCcCCcCCccceEeceeECCEEEEeeccCCCCChhhhhcCCcc
Confidence 99753321 23444442 34689999999998876542 23357789999999997632100000000000
Q ss_pred ccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEE
Q 014195 300 SRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHV 377 (429)
Q Consensus 300 ~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~ 377 (429)
..........+++|| .+++|+.+++||.+|..+ ++++++++|||+||...... .++++++|+++.+.++.
T Consensus 304 ~~~~~~~~~~~e~yd~~~~~W~~~~~lp~~r~~~--~av~~~~~iyv~GG~~~~~~------~~~~v~~~~~~~~~~~~ 374 (376)
T PRK14131 304 AHEGLKKSWSDEIYALVNGKWQKVGELPQGLAYG--VSVSWNNGVLLIGGETAGGK------AVSDVTLLSWDGKKLTV 374 (376)
T ss_pred cccCCcceeehheEEecCCcccccCcCCCCccce--EEEEeCCEEEEEcCCCCCCc------EeeeEEEEEEcCCEEEE
Confidence 000000012355677 899999999999999865 45889999999999865433 57899999999888764
No 14
>PHA03098 kelch-like protein; Provisional
Probab=100.00 E-value=6.3e-38 Score=316.64 Aligned_cols=261 Identities=21% Similarity=0.331 Sum_probs=217.4
Q ss_pred ccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe
Q 014195 91 TFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD 170 (429)
Q Consensus 91 ~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~ 170 (429)
.+..|++..++|..++++|. +..|++++++++||++||.+......+++++||+.+++|..+++|+. +|.+++++..
T Consensus 265 ~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~lyv~GG~~~~~~~~~~v~~yd~~~~~W~~~~~~~~--~R~~~~~~~~ 341 (534)
T PHA03098 265 NYITNYSPLSEINTIIDIHY-VYCFGSVVLNNVIYFIGGMNKNNLSVNSVVSYDTKTKSWNKVPELIY--PRKNPGVTVF 341 (534)
T ss_pred eeeecchhhhhcccccCccc-cccceEEEECCEEEEECCCcCCCCeeccEEEEeCCCCeeeECCCCCc--ccccceEEEE
Confidence 34567888889998877764 34578899999999999998766666789999999999999999987 6889999999
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCC-CCCccccceEeeeecC
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGEN-RYTPEVDHWSLAVKDG 249 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~-~~~~~~~~~~~~~~~~ 249 (429)
+++||++||.+... ..+++++||+.+++|+.+++||.+|..|+++.++++||++||.... ..... ++.|
T Consensus 342 ~~~lyv~GG~~~~~---~~~~v~~yd~~~~~W~~~~~lp~~r~~~~~~~~~~~iYv~GG~~~~~~~~~~-------v~~y 411 (534)
T PHA03098 342 NNRIYVIGGIYNSI---SLNTVESWKPGESKWREEPPLIFPRYNPCVVNVNNLIYVIGGISKNDELLKT-------VECF 411 (534)
T ss_pred CCEEEEEeCCCCCE---ecceEEEEcCCCCceeeCCCcCcCCccceEEEECCEEEEECCcCCCCcccce-------EEEE
Confidence 99999999987433 2789999999999999999999999999999999999999997532 22222 3445
Q ss_pred CccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCC
Q 014195 250 KPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKP 328 (429)
Q Consensus 250 d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~ 328 (429)
|+.+++|+..+++|.++.+++++.++++|||+||.+.... ....+++++|| .+++|+.+++++.+
T Consensus 412 d~~t~~W~~~~~~p~~r~~~~~~~~~~~iyv~GG~~~~~~--------------~~~~~~v~~yd~~~~~W~~~~~~~~~ 477 (534)
T PHA03098 412 SLNTNKWSKGSPLPISHYGGCAIYHDGKIYVIGGISYIDN--------------IKVYNIVESYNPVTNKWTELSSLNFP 477 (534)
T ss_pred eCCCCeeeecCCCCccccCceEEEECCEEEEECCccCCCC--------------CcccceEEEecCCCCceeeCCCCCcc
Confidence 6999999999999999999999999999999999764311 01245599999 89999999999998
Q ss_pred CCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceee
Q 014195 329 DSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKT 387 (429)
Q Consensus 329 r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~ 387 (429)
|..++ +++.+++|||+||.+... ..+++++||+++++|+.++.+|.....
T Consensus 478 r~~~~--~~~~~~~iyv~GG~~~~~-------~~~~v~~yd~~~~~W~~~~~~p~~~~~ 527 (534)
T PHA03098 478 RINAS--LCIFNNKIYVVGGDKYEY-------YINEIEVYDDKTNTWTLFCKFPKVIGS 527 (534)
T ss_pred cccce--EEEECCEEEEEcCCcCCc-------ccceeEEEeCCCCEEEecCCCcccccc
Confidence 87654 477899999999988654 367999999999999999887765443
No 15
>TIGR03548 mutarot_permut cyclically-permuted mutatrotase family protein. Members of this protein family show essentially full-length homology, cyclically permuted, to YjhT from Escherichia coli. YjhT was shown to act as a mutarotase for sialic acid, and by this ability to be able to act as a virulence factor. Members of the YjhT family (TIGR03547) and this cyclically-permuted family have multiple repeats of the beta-propeller-forming Kelch repeat.
Probab=100.00 E-value=2.7e-37 Score=292.12 Aligned_cols=282 Identities=19% Similarity=0.235 Sum_probs=202.9
Q ss_pred HHHHHHHhhcceeeeecCCCcccc-eeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCccccccccccc-cc-CC
Q 014195 24 VMILGFALVADFFWASSSKFTSSY-LNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLP-AP-EL 100 (429)
Q Consensus 24 ~~~~~~~~~~~~ly~~GG~~~~~~-~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d-~~-~~ 100 (429)
++.+.+++++++||++||.+.... +. ..+.....+.++.++ +. +.
T Consensus 4 ~~g~~~~~~~~~l~v~GG~~~~~~~~~--------------------------------~~g~~~~~~~v~~~~~~~~~~ 51 (323)
T TIGR03548 4 VAGCYAGIIGDYILVAGGCNFPEDPLA--------------------------------EGGKKKNYKGIYIAKDENSNL 51 (323)
T ss_pred eeeEeeeEECCEEEEeeccCCCCCchh--------------------------------hCCcEEeeeeeEEEecCCCce
Confidence 456788999999999999654220 00 001111223344443 33 23
Q ss_pred CeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCce----eeCCCCCCCCccceeeEEEeCCEEEE
Q 014195 101 KWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTW----GGRFDMPREMAHSHLGMVTDGRYIYV 176 (429)
Q Consensus 101 ~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W----~~~~~~~~~~~r~~~~~~~~~~~lyv 176 (429)
+|..+++||.+|..+++++++++||++||.++... ++++++||+.+++| +.+++||. +|..+++++++++|||
T Consensus 52 ~W~~~~~lp~~r~~~~~~~~~~~lyviGG~~~~~~-~~~v~~~d~~~~~w~~~~~~~~~lp~--~~~~~~~~~~~~~iYv 128 (323)
T TIGR03548 52 KWVKDGQLPYEAAYGASVSVENGIYYIGGSNSSER-FSSVYRITLDESKEELICETIGNLPF--TFENGSACYKDGTLYV 128 (323)
T ss_pred eEEEcccCCccccceEEEEECCEEEEEcCCCCCCC-ceeEEEEEEcCCceeeeeeEcCCCCc--CccCceEEEECCEEEE
Confidence 79999999999998889999999999999876544 57899999999998 67888887 6778899999999999
Q ss_pred EeCeeCCCCCCCCceeEEEeCCCCceEeCCCCC-CCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccc
Q 014195 177 VTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLP-VPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKE 255 (429)
Q Consensus 177 ~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p-~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~ 255 (429)
+||...... .+++++||+.+++|+.+++|| .+|..|++++++++|||+||.+...+ . +++.||+.+++
T Consensus 129 ~GG~~~~~~---~~~v~~yd~~~~~W~~~~~~p~~~r~~~~~~~~~~~iYv~GG~~~~~~-~-------~~~~yd~~~~~ 197 (323)
T TIGR03548 129 GGGNRNGKP---SNKSYLFNLETQEWFELPDFPGEPRVQPVCVKLQNELYVFGGGSNIAY-T-------DGYKYSPKKNQ 197 (323)
T ss_pred EeCcCCCcc---CceEEEEcCCCCCeeECCCCCCCCCCcceEEEECCEEEEEcCCCCccc-c-------ceEEEecCCCe
Confidence 999754332 789999999999999999988 58999999999999999999864321 1 13455699999
Q ss_pred eeeccCC-----CCCCCcee-EEEeCCEEEEEcccCCCCCC---CCCCC----------ccccc--cCCeeeeCceEEeC
Q 014195 256 WRTEIPI-----PRGGPHRA-CVVVDDRLLVIGGQEGDFMA---KPGSP----------IFKCS--RRNEVVYDDVYMLD 314 (429)
Q Consensus 256 W~~~~~~-----p~~~~~~~-~~~~~~~iyv~GG~~~~~~~---~~~~~----------~~~~~--~~~~~~~~~v~~~d 314 (429)
|+.++++ |+.+..++ +++.+++|||+||.+..... +.... .+... .....+.+++++||
T Consensus 198 W~~~~~~~~~~~p~~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~yd 277 (323)
T TIGR03548 198 WQKVADPTTDSEPISLLGAASIKINESLLLCIGGFNKDVYNDAVIDLATMKDESLKGYKKEYFLKPPEWYNWNRKILIYN 277 (323)
T ss_pred eEECCCCCCCCCceeccceeEEEECCCEEEEECCcCHHHHHHHHhhhhhccchhhhhhHHHHhCCCccccCcCceEEEEE
Confidence 9998765 44443334 44557999999998642100 00000 00000 00011246799999
Q ss_pred -CCCCeEEcCCCC-CCCCCcceeEEEECCEEEEEcccCCCC
Q 014195 315 -DEMKWKVLPSMP-KPDSHIEFAWVLVNNSIVIVGGTTEKH 353 (429)
Q Consensus 315 -~~~~W~~~~~~~-~~r~~~~~~~~~~~~~i~v~GG~~~~~ 353 (429)
.+++|+.++++| .+|..+ +++.++++||++||.....
T Consensus 278 ~~~~~W~~~~~~p~~~r~~~--~~~~~~~~iyv~GG~~~pg 316 (323)
T TIGR03548 278 VRTGKWKSIGNSPFFARCGA--ALLLTGNNIFSINGELKPG 316 (323)
T ss_pred CCCCeeeEcccccccccCch--heEEECCEEEEEeccccCC
Confidence 999999999876 466654 5689999999999986554
No 16
>KOG4693 consensus Uncharacterized conserved protein, contains kelch repeat [General function prediction only]
Probab=100.00 E-value=5.7e-37 Score=261.23 Aligned_cols=283 Identities=21% Similarity=0.346 Sum_probs=222.2
Q ss_pred CeEEccCCCCCccCCcEEEECCEEEEEeccCC-CC---ceeeeEEEEECCCCceeeCCC------C--C---CCCcccee
Q 014195 101 KWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGS-ID---YVHSHVDIYNFTDNTWGGRFD------M--P---REMAHSHL 165 (429)
Q Consensus 101 ~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~-~~---~~~~~~~~yd~~~~~W~~~~~------~--~---~~~~r~~~ 165 (429)
.|+.--+-...|..|+++.++..||-|||+-. +. .-.-+|.++|..+-+|+++++ + + .|..|++|
T Consensus 3 ~WTVHLeGGPrRVNHAavaVG~riYSFGGYCsGedy~~~~piDVH~lNa~~~RWtk~pp~~~ka~i~~~yp~VPyqRYGH 82 (392)
T KOG4693|consen 3 TWTVHLEGGPRRVNHAAVAVGSRIYSFGGYCSGEDYDAKDPIDVHVLNAENYRWTKMPPGITKATIESPYPAVPYQRYGH 82 (392)
T ss_pred eEEEEecCCcccccceeeeecceEEecCCcccccccccCCcceeEEeeccceeEEecCcccccccccCCCCccchhhcCc
Confidence 45443333345789999999999999999732 21 112359999999999999865 1 1 24569999
Q ss_pred eEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC---CCCCCCCCceEEEECCEEEEEeCCCCCCCCccccce
Q 014195 166 GMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP---PLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHW 242 (429)
Q Consensus 166 ~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~---~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~ 242 (429)
+++.+++++|+.||++..... .+.+++|||++++|.+.. -+|.+|.+|+++++++.+|||||+..+ .++|
T Consensus 83 tvV~y~d~~yvWGGRND~ega--CN~Ly~fDp~t~~W~~p~v~G~vPgaRDGHsAcV~gn~MyiFGGye~~-----a~~F 155 (392)
T KOG4693|consen 83 TVVEYQDKAYVWGGRNDDEGA--CNLLYEFDPETNVWKKPEVEGFVPGARDGHSACVWGNQMYIFGGYEED-----AQRF 155 (392)
T ss_pred eEEEEcceEEEEcCccCcccc--cceeeeeccccccccccceeeecCCccCCceeeEECcEEEEecChHHH-----HHhh
Confidence 999999999999999775533 789999999999999874 589999999999999999999998643 3333
Q ss_pred EeeeecCCccccceeec---cCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCC
Q 014195 243 SLAVKDGKPLEKEWRTE---IPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMK 318 (429)
Q Consensus 243 ~~~~~~~d~~~~~W~~~---~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~ 318 (429)
+-+++.+|..|.+|+.. ...|+-|-.|+++++++.+|||||...... | .-...+.+.+++..+| .+..
T Consensus 156 S~d~h~ld~~TmtWr~~~Tkg~PprwRDFH~a~~~~~~MYiFGGR~D~~g--p------fHs~~e~Yc~~i~~ld~~T~a 227 (392)
T KOG4693|consen 156 SQDTHVLDFATMTWREMHTKGDPPRWRDFHTASVIDGMMYIFGGRSDESG--P------FHSIHEQYCDTIMALDLATGA 227 (392)
T ss_pred hccceeEeccceeeeehhccCCCchhhhhhhhhhccceEEEeccccccCC--C------ccchhhhhcceeEEEeccccc
Confidence 33344445789999974 445777878899999999999999865432 1 1123455778888999 9999
Q ss_pred eEEcCC---CCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEe---cccCcceeeeeeEE
Q 014195 319 WKVLPS---MPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVI---GKLPYRVKTTLAGY 392 (429)
Q Consensus 319 W~~~~~---~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v---~~lp~~r~~~~~~~ 392 (429)
|...++ .|..|. ++++.+.++++|+|||+++.-+. -++++|.|||.+..|..+ +.-|.+|..+++++
T Consensus 228 W~r~p~~~~~P~GRR--SHS~fvYng~~Y~FGGYng~ln~-----HfndLy~FdP~t~~W~~I~~~Gk~P~aRRRqC~~v 300 (392)
T KOG4693|consen 228 WTRTPENTMKPGGRR--SHSTFVYNGKMYMFGGYNGTLNV-----HFNDLYCFDPKTSMWSVISVRGKYPSARRRQCSVV 300 (392)
T ss_pred cccCCCCCcCCCccc--ccceEEEcceEEEecccchhhhh-----hhcceeecccccchheeeeccCCCCCcccceeEEE
Confidence 998864 355555 45669999999999999975431 468999999999999998 67899999999999
Q ss_pred ECCEEEEEcccCC
Q 014195 393 WNGWLYFTSGQRD 405 (429)
Q Consensus 393 ~~~~i~v~GG~~~ 405 (429)
.++|+|+|||..-
T Consensus 301 ~g~kv~LFGGTsP 313 (392)
T KOG4693|consen 301 SGGKVYLFGGTSP 313 (392)
T ss_pred ECCEEEEecCCCC
Confidence 9999999999754
No 17
>PHA02790 Kelch-like protein; Provisional
Probab=100.00 E-value=3.9e-36 Score=297.22 Aligned_cols=210 Identities=19% Similarity=0.350 Sum_probs=180.7
Q ss_pred EEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEe
Q 014195 117 AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLD 196 (429)
Q Consensus 117 ~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd 196 (429)
++.+++.||++||.++.. ..+++++|||.+++|..+++|+. +|..++++..+++||++||.++ .+++++||
T Consensus 267 ~~~~~~~lyviGG~~~~~-~~~~v~~Ydp~~~~W~~~~~m~~--~r~~~~~v~~~~~iYviGG~~~------~~sve~yd 337 (480)
T PHA02790 267 STHVGEVVYLIGGWMNNE-IHNNAIAVNYISNNWIPIPPMNS--PRLYASGVPANNKLYVVGGLPN------PTSVERWF 337 (480)
T ss_pred eEEECCEEEEEcCCCCCC-cCCeEEEEECCCCEEEECCCCCc--hhhcceEEEECCEEEEECCcCC------CCceEEEE
Confidence 455899999999986543 35679999999999999999988 7888899999999999999753 35689999
Q ss_pred CCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCC
Q 014195 197 TETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDD 276 (429)
Q Consensus 197 ~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~ 276 (429)
+.+++|+.+++||.+|..+++++++++||++||.+.. ... +++|||.+++|+..++|+.++..++++++++
T Consensus 338 p~~n~W~~~~~l~~~r~~~~~~~~~g~IYviGG~~~~--~~~-------ve~ydp~~~~W~~~~~m~~~r~~~~~~~~~~ 408 (480)
T PHA02790 338 HGDAAWVNMPSLLKPRCNPAVASINNVIYVIGGHSET--DTT-------TEYLLPNHDQWQFGPSTYYPHYKSCALVFGR 408 (480)
T ss_pred CCCCeEEECCCCCCCCcccEEEEECCEEEEecCcCCC--Ccc-------EEEEeCCCCEEEeCCCCCCccccceEEEECC
Confidence 9999999999999999999999999999999997532 122 3445699999999999999998889999999
Q ss_pred EEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCC
Q 014195 277 RLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPT 355 (429)
Q Consensus 277 ~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~ 355 (429)
+|||+||. ++.|| .+++|+.+++|+.+|..++ +++++|+||++||.+...
T Consensus 409 ~IYv~GG~-------------------------~e~ydp~~~~W~~~~~m~~~r~~~~--~~v~~~~IYviGG~~~~~-- 459 (480)
T PHA02790 409 RLFLVGRN-------------------------AEFYCESSNTWTLIDDPIYPRDNPE--LIIVDNKLLLIGGFYRGS-- 459 (480)
T ss_pred EEEEECCc-------------------------eEEecCCCCcEeEcCCCCCCccccE--EEEECCEEEEECCcCCCc--
Confidence 99999984 45677 8999999999999998764 589999999999987433
Q ss_pred ccceeeeCcEEEEecCCCCeEEe
Q 014195 356 TKKMVLVGEIFQFNLNTLKWHVI 378 (429)
Q Consensus 356 ~~~~~~~~~i~~yd~~~~~W~~v 378 (429)
.++.++.|||++++|+..
T Consensus 460 -----~~~~ve~Yd~~~~~W~~~ 477 (480)
T PHA02790 460 -----YIDTIEVYNNRTYSWNIW 477 (480)
T ss_pred -----ccceEEEEECCCCeEEec
Confidence 356899999999999864
No 18
>KOG4693 consensus Uncharacterized conserved protein, contains kelch repeat [General function prediction only]
Probab=100.00 E-value=5.2e-37 Score=261.43 Aligned_cols=281 Identities=17% Similarity=0.292 Sum_probs=216.5
Q ss_pred CceehhHHHHHHHHHHhhcceeeeecCCC-c----ccceeeeeeecCCCCe-EEecCCCCCCCcceeeeecCCCCcCccc
Q 014195 15 PARVVLSIFVMILGFALVADFFWASSSKF-T----SSYLNIASNWSPYHNS-IILPNNGPQKGENIGVKTKKDVVPKRIL 88 (429)
Q Consensus 15 ~~~~~~~~~~~~~~~~~~~~~ly~~GG~~-~----~~~~~~~~~yd~~~~~-~~~p~~~~r~~~~~~~~~~~~~~~~~~~ 88 (429)
|||| -|+++.++++||-|||+= | ....-+++.++.++-+ +.+|+. +
T Consensus 12 PrRV-------NHAavaVG~riYSFGGYCsGedy~~~~piDVH~lNa~~~RWtk~pp~---------------------~ 63 (392)
T KOG4693|consen 12 PRRV-------NHAAVAVGSRIYSFGGYCSGEDYDAKDPIDVHVLNAENYRWTKMPPG---------------------I 63 (392)
T ss_pred cccc-------cceeeeecceEEecCCcccccccccCCcceeEEeeccceeEEecCcc---------------------c
Confidence 5677 899999999999999953 2 1123345555555555 555541 0
Q ss_pred ccccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeC---CCCCCCCcccee
Q 014195 89 PATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGR---FDMPREMAHSHL 165 (429)
Q Consensus 89 ~~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~---~~~~~~~~r~~~ 165 (429)
.++.. + .+-+..|..|.+|+++.+++++||.||.+.....-+-+++|||++++|.+. ..+|. +|.+|
T Consensus 64 ~ka~i-----~---~~yp~VPyqRYGHtvV~y~d~~yvWGGRND~egaCN~Ly~fDp~t~~W~~p~v~G~vPg--aRDGH 133 (392)
T KOG4693|consen 64 TKATI-----E---SPYPAVPYQRYGHTVVEYQDKAYVWGGRNDDEGACNLLYEFDPETNVWKKPEVEGFVPG--ARDGH 133 (392)
T ss_pred ccccc-----c---CCCCccchhhcCceEEEEcceEEEEcCccCcccccceeeeeccccccccccceeeecCC--ccCCc
Confidence 00000 0 001234677999999999999999999988666667799999999999864 33554 89999
Q ss_pred eEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC---CCCCCCCCceEEEECCEEEEEeCCCCC--CCCcccc
Q 014195 166 GMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP---PLPVPRYAPATQLWRGRLHVMGGSGEN--RYTPEVD 240 (429)
Q Consensus 166 ~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~---~~p~~r~~~~~~~~~~~lyv~GG~~~~--~~~~~~~ 240 (429)
++++.++.+|||||+...... ..+++..+|.+|.+|+.+. ..|.-|..|+++++++.+|||||..++ .+....+
T Consensus 134 sAcV~gn~MyiFGGye~~a~~-FS~d~h~ld~~TmtWr~~~Tkg~PprwRDFH~a~~~~~~MYiFGGR~D~~gpfHs~~e 212 (392)
T KOG4693|consen 134 SACVWGNQMYIFGGYEEDAQR-FSQDTHVLDFATMTWREMHTKGDPPRWRDFHTASVIDGMMYIFGGRSDESGPFHSIHE 212 (392)
T ss_pred eeeEECcEEEEecChHHHHHh-hhccceeEeccceeeeehhccCCCchhhhhhhhhhccceEEEeccccccCCCccchhh
Confidence 999999999999998655432 3679999999999999985 456678999999999999999998653 3445556
Q ss_pred ceEeeeecCCccccceeeccC---CCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CC
Q 014195 241 HWSLAVKDGKPLEKEWRTEIP---IPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DE 316 (429)
Q Consensus 241 ~~~~~~~~~d~~~~~W~~~~~---~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~ 316 (429)
.|.-.+-.+|..|..|...++ .|.+|.+|++.+++++||+|||+++.- ..-.+|+|+|| .+
T Consensus 213 ~Yc~~i~~ld~~T~aW~r~p~~~~~P~GRRSHS~fvYng~~Y~FGGYng~l---------------n~HfndLy~FdP~t 277 (392)
T KOG4693|consen 213 QYCDTIMALDLATGAWTRTPENTMKPGGRRSHSTFVYNGKMYMFGGYNGTL---------------NVHFNDLYCFDPKT 277 (392)
T ss_pred hhcceeEEEeccccccccCCCCCcCCCcccccceEEEcceEEEecccchhh---------------hhhhcceeeccccc
Confidence 666666667789999998644 488899999999999999999998652 23578999999 89
Q ss_pred CCeEEcCC---CCCCCCCcceeEEEECCEEEEEcccCC
Q 014195 317 MKWKVLPS---MPKPDSHIEFAWVLVNNSIVIVGGTTE 351 (429)
Q Consensus 317 ~~W~~~~~---~~~~r~~~~~~~~~~~~~i~v~GG~~~ 351 (429)
..|..+.. -|.+|.++ | +++.++++|+|||...
T Consensus 278 ~~W~~I~~~Gk~P~aRRRq-C-~~v~g~kv~LFGGTsP 313 (392)
T KOG4693|consen 278 SMWSVISVRGKYPSARRRQ-C-SVVSGGKVYLFGGTSP 313 (392)
T ss_pred chheeeeccCCCCCcccce-e-EEEECCEEEEecCCCC
Confidence 99999863 58888875 3 4899999999999875
No 19
>PHA03098 kelch-like protein; Provisional
Probab=100.00 E-value=3.4e-35 Score=296.78 Aligned_cols=247 Identities=20% Similarity=0.312 Sum_probs=201.9
Q ss_pred CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc
Q 014195 122 NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK 201 (429)
Q Consensus 122 ~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~ 201 (429)
..+++.||.+. . ...+..|++.+++|..+++++. +..+++++.++.||++||...... ..+++++||+.+++
T Consensus 251 ~~~~~~~g~~~--~-~~~~~~~~~~~~~~~~~~~~~~---~~~~~~~~~~~~lyv~GG~~~~~~--~~~~v~~yd~~~~~ 322 (534)
T PHA03098 251 SIIYIHITMSI--F-TYNYITNYSPLSEINTIIDIHY---VYCFGSVVLNNVIYFIGGMNKNNL--SVNSVVSYDTKTKS 322 (534)
T ss_pred cceEeecccch--h-hceeeecchhhhhcccccCccc---cccceEEEECCEEEEECCCcCCCC--eeccEEEEeCCCCe
Confidence 34566566542 1 2346789999999998876654 345788899999999999865442 26789999999999
Q ss_pred eEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEE
Q 014195 202 WQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVI 281 (429)
Q Consensus 202 W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~ 281 (429)
|..+++||.+|..|++++++++||++||........+++ .||+.+++|+..+++|.++..++++.++++|||+
T Consensus 323 W~~~~~~~~~R~~~~~~~~~~~lyv~GG~~~~~~~~~v~-------~yd~~~~~W~~~~~lp~~r~~~~~~~~~~~iYv~ 395 (534)
T PHA03098 323 WNKVPELIYPRKNPGVTVFNNRIYVIGGIYNSISLNTVE-------SWKPGESKWREEPPLIFPRYNPCVVNVNNLIYVI 395 (534)
T ss_pred eeECCCCCcccccceEEEECCEEEEEeCCCCCEecceEE-------EEcCCCCceeeCCCcCcCCccceEEEECCEEEEE
Confidence 999999999999999999999999999987544433333 3459999999999999999999999999999999
Q ss_pred cccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCcccee
Q 014195 282 GGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMV 360 (429)
Q Consensus 282 GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~ 360 (429)
||...... ..+++++|| .+++|+.++++|.+|..+ +++..+++||++||.+......
T Consensus 396 GG~~~~~~----------------~~~~v~~yd~~t~~W~~~~~~p~~r~~~--~~~~~~~~iyv~GG~~~~~~~~---- 453 (534)
T PHA03098 396 GGISKNDE----------------LLKTVECFSLNTNKWSKGSPLPISHYGG--CAIYHDGKIYVIGGISYIDNIK---- 453 (534)
T ss_pred CCcCCCCc----------------ccceEEEEeCCCCeeeecCCCCccccCc--eEEEECCEEEEECCccCCCCCc----
Confidence 99743211 256799999 899999999999988865 4588999999999987543211
Q ss_pred eeCcEEEEecCCCCeEEecccCcceeeeeeEEECCEEEEEcccCC
Q 014195 361 LVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRD 405 (429)
Q Consensus 361 ~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~ 405 (429)
.++++++||+++++|+.++++|.+|..++++.++++||++||...
T Consensus 454 ~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~~~~iyv~GG~~~ 498 (534)
T PHA03098 454 VYNIVESYNPVTNKWTELSSLNFPRINASLCIFNNKIYVVGGDKY 498 (534)
T ss_pred ccceEEEecCCCCceeeCCCCCcccccceEEEECCEEEEEcCCcC
Confidence 245799999999999999999999999999999999999999764
No 20
>PHA02790 Kelch-like protein; Provisional
Probab=100.00 E-value=2.3e-35 Score=291.75 Aligned_cols=209 Identities=19% Similarity=0.288 Sum_probs=179.1
Q ss_pred HhhcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccCCC
Q 014195 30 ALVADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKAAP 109 (429)
Q Consensus 30 ~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p 109 (429)
+.+++.||++||.++...++.+++| |+.+++|..+++|+
T Consensus 268 ~~~~~~lyviGG~~~~~~~~~v~~Y-----------------------------------------dp~~~~W~~~~~m~ 306 (480)
T PHA02790 268 THVGEVVYLIGGWMNNEIHNNAIAV-----------------------------------------NYISNNWIPIPPMN 306 (480)
T ss_pred EEECCEEEEEcCCCCCCcCCeEEEE-----------------------------------------ECCCCEEEECCCCC
Confidence 4489999999997654444455555 55778999999999
Q ss_pred CCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCC
Q 014195 110 VPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPT 189 (429)
Q Consensus 110 ~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~ 189 (429)
.+|..+++++++++||++||.++. +++++||+.+++|+.+++||. +|..+++++++++||++||.++. .
T Consensus 307 ~~r~~~~~v~~~~~iYviGG~~~~----~sve~ydp~~n~W~~~~~l~~--~r~~~~~~~~~g~IYviGG~~~~-----~ 375 (480)
T PHA02790 307 SPRLYASGVPANNKLYVVGGLPNP----TSVERWFHGDAAWVNMPSLLK--PRCNPAVASINNVIYVIGGHSET-----D 375 (480)
T ss_pred chhhcceEEEECCEEEEECCcCCC----CceEEEECCCCeEEECCCCCC--CCcccEEEEECCEEEEecCcCCC-----C
Confidence 999999999999999999998642 459999999999999999998 78899999999999999997532 3
Q ss_pred ceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCce
Q 014195 190 AHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHR 269 (429)
Q Consensus 190 ~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~ 269 (429)
+.+++|||.+++|+.+++|+.+|..+++++++++|||+||. .+ .|||.+++|+.+++|+.++..+
T Consensus 376 ~~ve~ydp~~~~W~~~~~m~~~r~~~~~~~~~~~IYv~GG~--------~e-------~ydp~~~~W~~~~~m~~~r~~~ 440 (480)
T PHA02790 376 TTTEYLLPNHDQWQFGPSTYYPHYKSCALVFGRRLFLVGRN--------AE-------FYCESSNTWTLIDDPIYPRDNP 440 (480)
T ss_pred ccEEEEeCCCCEEEeCCCCCCccccceEEEECCEEEEECCc--------eE-------EecCCCCcEeEcCCCCCCcccc
Confidence 67999999999999999999999999999999999999983 23 3459999999999999999999
Q ss_pred eEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEc
Q 014195 270 ACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVL 322 (429)
Q Consensus 270 ~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~ 322 (429)
++++++|+|||+||.+... ..+.+++|| .+++|+..
T Consensus 441 ~~~v~~~~IYviGG~~~~~-----------------~~~~ve~Yd~~~~~W~~~ 477 (480)
T PHA02790 441 ELIIVDNKLLLIGGFYRGS-----------------YIDTIEVYNNRTYSWNIW 477 (480)
T ss_pred EEEEECCEEEEECCcCCCc-----------------ccceEEEEECCCCeEEec
Confidence 9999999999999986321 235689999 99999864
No 21
>KOG1230 consensus Protein containing repeated kelch motifs [General function prediction only]
Probab=99.97 E-value=3.1e-31 Score=238.90 Aligned_cols=261 Identities=19% Similarity=0.316 Sum_probs=198.1
Q ss_pred cCCCCCccCCcEEEE--CCEEEEEecc--CCC-CceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeC-CEEEEEeC
Q 014195 106 KAAPVPRLDGAAIQI--KNLLYVFAGY--GSI-DYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDG-RYIYVVTG 179 (429)
Q Consensus 106 ~~~p~~R~~~~~~~~--~~~iyv~GG~--~~~-~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~-~~lyv~GG 179 (429)
.+.|.||.+++++.. .+.|++|||. ++. ..+.++++.||.++++|+++.....|.||+.|.++++- |.+|+|||
T Consensus 61 ~~~PspRsn~sl~~nPekeELilfGGEf~ngqkT~vYndLy~Yn~k~~eWkk~~spn~P~pRsshq~va~~s~~l~~fGG 140 (521)
T KOG1230|consen 61 VPPPSPRSNPSLFANPEKEELILFGGEFYNGQKTHVYNDLYSYNTKKNEWKKVVSPNAPPPRSSHQAVAVPSNILWLFGG 140 (521)
T ss_pred CCCCCCCCCcceeeccCcceeEEecceeecceeEEEeeeeeEEeccccceeEeccCCCcCCCccceeEEeccCeEEEecc
Confidence 456889999998876 5689999996 332 34778999999999999998766666689999888875 89999999
Q ss_pred eeCCC---CCCCCceeEEEeCCCCceEeCC--CCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcccc
Q 014195 180 QYGPQ---CRGPTAHTFVLDTETKKWQDLP--PLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEK 254 (429)
Q Consensus 180 ~~~~~---~~~~~~~~~~yd~~t~~W~~~~--~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~ 254 (429)
....- ..-...++|.||+.+++|+++. .-|.||++|.+++.+.+|++|||+... +....|-.++++||..+-
T Consensus 141 EfaSPnq~qF~HYkD~W~fd~~trkweql~~~g~PS~RSGHRMvawK~~lilFGGFhd~---nr~y~YyNDvy~FdLdty 217 (521)
T KOG1230|consen 141 EFASPNQEQFHHYKDLWLFDLKTRKWEQLEFGGGPSPRSGHRMVAWKRQLILFGGFHDS---NRDYIYYNDVYAFDLDTY 217 (521)
T ss_pred ccCCcchhhhhhhhheeeeeeccchheeeccCCCCCCCccceeEEeeeeEEEEcceecC---CCceEEeeeeEEEeccce
Confidence 75432 1223689999999999999985 578999999999999999999998643 222334445666678899
Q ss_pred ceeeccCC---CCCCCceeEEEe-CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CC-----CCeEEcCC
Q 014195 255 EWRTEIPI---PRGGPHRACVVV-DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DE-----MKWKVLPS 324 (429)
Q Consensus 255 ~W~~~~~~---p~~~~~~~~~~~-~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~-----~~W~~~~~ 324 (429)
+|+.+.|. |.+|++++..+. +|.|||+||+..... +-.-...+..+|+|.++ .. -.|+++.+
T Consensus 218 kW~Klepsga~PtpRSGcq~~vtpqg~i~vyGGYsK~~~--------kK~~dKG~~hsDmf~L~p~~~~~dKw~W~kvkp 289 (521)
T KOG1230|consen 218 KWSKLEPSGAGPTPRSGCQFSVTPQGGIVVYGGYSKQRV--------KKDVDKGTRHSDMFLLKPEDGREDKWVWTKVKP 289 (521)
T ss_pred eeeeccCCCCCCCCCCcceEEecCCCcEEEEcchhHhhh--------hhhhhcCceeeeeeeecCCcCCCcceeEeeccC
Confidence 99986542 667777777777 999999999975432 11222345678999998 44 46888865
Q ss_pred ---CCCCCCCcceeEEEECCEEEEEcccCCCCC--CccceeeeCcEEEEecCCCCeEEe
Q 014195 325 ---MPKPDSHIEFAWVLVNNSIVIVGGTTEKHP--TTKKMVLVGEIFQFNLNTLKWHVI 378 (429)
Q Consensus 325 ---~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~--~~~~~~~~~~i~~yd~~~~~W~~v 378 (429)
.|.||...+++ +..+++.|.|||.-+-.. ..-...|+|+++.||...++|...
T Consensus 290 ~g~kPspRsgfsv~-va~n~kal~FGGV~D~eeeeEsl~g~F~NDLy~fdlt~nrW~~~ 347 (521)
T KOG1230|consen 290 SGVKPSPRSGFSVA-VAKNHKALFFGGVCDLEEEEESLSGEFFNDLYFFDLTRNRWSEG 347 (521)
T ss_pred CCCCCCCCCceeEE-EecCCceEEecceecccccchhhhhhhhhhhhheecccchhhHh
Confidence 48889887664 556779999999765221 222344899999999999999653
No 22
>KOG4152 consensus Host cell transcription factor HCFC1 [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.97 E-value=8.6e-30 Score=234.96 Aligned_cols=301 Identities=22% Similarity=0.378 Sum_probs=224.6
Q ss_pred CCeEEcc----CCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeC---CCCCCCCccceeeEEEeCC
Q 014195 100 LKWEKMK----AAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGR---FDMPREMAHSHLGMVTDGR 172 (429)
Q Consensus 100 ~~W~~~~----~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~---~~~~~~~~r~~~~~~~~~~ 172 (429)
-.|+++. +.|.||++|.++.+.+.|+||||-+.. ..+++++||..+++|..- .++|. +...|+++..+.
T Consensus 17 ~rWrrV~~~tGPvPrpRHGHRAVaikELiviFGGGNEG--iiDELHvYNTatnqWf~PavrGDiPp--gcAA~GfvcdGt 92 (830)
T KOG4152|consen 17 VRWRRVQQSTGPVPRPRHGHRAVAIKELIVIFGGGNEG--IIDELHVYNTATNQWFAPAVRGDIPP--GCAAFGFVCDGT 92 (830)
T ss_pred cceEEEecccCCCCCccccchheeeeeeEEEecCCccc--chhhhhhhccccceeecchhcCCCCC--chhhcceEecCc
Confidence 4798875 457889999999999999999996533 467899999999999753 46665 566788899999
Q ss_pred EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC-------CCCCCCCCceEEEECCEEEEEeCCCCCCCC--ccccceE
Q 014195 173 YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP-------PLPVPRYAPATQLWRGRLHVMGGSGENRYT--PEVDHWS 243 (429)
Q Consensus 173 ~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~-------~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~--~~~~~~~ 243 (429)
+||+|||....+.+ .+++|.+....-.|.++. +.|.||.+|+...+++|.|+|||..++.-+ +.+-+|-
T Consensus 93 rilvFGGMvEYGkY--sNdLYELQasRWeWkrlkp~~p~nG~pPCPRlGHSFsl~gnKcYlFGGLaNdseDpknNvPrYL 170 (830)
T KOG4152|consen 93 RILVFGGMVEYGKY--SNDLYELQASRWEWKRLKPKTPKNGPPPCPRLGHSFSLVGNKCYLFGGLANDSEDPKNNVPRYL 170 (830)
T ss_pred eEEEEccEeeeccc--cchHHHhhhhhhhHhhcCCCCCCCCCCCCCccCceeEEeccEeEEeccccccccCcccccchhh
Confidence 99999999877654 788877777777788874 467999999999999999999998643222 1222222
Q ss_pred eeeecC--Ccc--ccceee---ccCCCCCCCceeEEEe------CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCce
Q 014195 244 LAVKDG--KPL--EKEWRT---EIPIPRGGPHRACVVV------DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDV 310 (429)
Q Consensus 244 ~~~~~~--d~~--~~~W~~---~~~~p~~~~~~~~~~~------~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v 310 (429)
-+.|.. .+. --.|.. -..+|..|-+|+++++ ..++||+||.++. .+.|+
T Consensus 171 nDlY~leL~~Gsgvv~W~ip~t~Gv~P~pRESHTAViY~eKDs~~skmvvyGGM~G~------------------RLgDL 232 (830)
T KOG4152|consen 171 NDLYILELRPGSGVVAWDIPITYGVLPPPRESHTAVIYTEKDSKKSKMVVYGGMSGC------------------RLGDL 232 (830)
T ss_pred cceEEEEeccCCceEEEecccccCCCCCCcccceeEEEEeccCCcceEEEEcccccc------------------cccce
Confidence 111111 122 234775 3456777777899888 3469999999876 46789
Q ss_pred EEeC-CCCCeEEcC---CCCCCCCCcceeEEEECCEEEEEcccCCCCC-------CccceeeeCcEEEEecCCCCeEEe-
Q 014195 311 YMLD-DEMKWKVLP---SMPKPDSHIEFAWVLVNNSIVIVGGTTEKHP-------TTKKMVLVGEIFQFNLNTLKWHVI- 378 (429)
Q Consensus 311 ~~~d-~~~~W~~~~---~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~-------~~~~~~~~~~i~~yd~~~~~W~~v- 378 (429)
|.+| ++.+|.+.. -.|.||+.|+. .+.+|++|||||+-.... ..++..+.+.+-++|+++..|+.+
T Consensus 233 W~Ldl~Tl~W~kp~~~G~~PlPRSLHsa--~~IGnKMyvfGGWVPl~~~~~~~~~hekEWkCTssl~clNldt~~W~tl~ 310 (830)
T KOG4152|consen 233 WTLDLDTLTWNKPSLSGVAPLPRSLHSA--TTIGNKMYVFGGWVPLVMDDVKVATHEKEWKCTSSLACLNLDTMAWETLL 310 (830)
T ss_pred eEEecceeecccccccCCCCCCcccccc--eeecceeEEecceeeeeccccccccccceeeeccceeeeeecchheeeee
Confidence 9999 999999875 35888998754 899999999999753211 223344678899999999999887
Q ss_pred ------cccCcceeeeeeEEECCEEEEEcccCCCCCCCCCC-ccccccEEeeeeecC
Q 014195 379 ------GKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDPAP-RKVHGDMWRTKLLLN 428 (429)
Q Consensus 379 ------~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~~~-~~~~~d~w~~~~~~~ 428 (429)
...|.+|.+|+++.++.+||+..|.+. .+...- .-.-.|+|-+|-+++
T Consensus 311 ~d~~ed~tiPR~RAGHCAvAigtRlYiWSGRDG--YrKAwnnQVCCkDlWyLdTekP 365 (830)
T KOG4152|consen 311 MDTLEDNTIPRARAGHCAVAIGTRLYIWSGRDG--YRKAWNNQVCCKDLWYLDTEKP 365 (830)
T ss_pred eccccccccccccccceeEEeccEEEEEeccch--hhHhhccccchhhhhhhcccCC
Confidence 237889999999999999999999764 332211 223468998876654
No 23
>KOG0379 consensus Kelch repeat-containing proteins [General function prediction only]
Probab=99.96 E-value=2.7e-28 Score=240.14 Aligned_cols=258 Identities=25% Similarity=0.420 Sum_probs=206.3
Q ss_pred cCCCCCccCCcEEEECCEEEEEeccCCCCceee-eEEEEECCCCceeeCC-CCCCCCccceeeEEEeCCEEEEEeCeeCC
Q 014195 106 KAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHS-HVDIYNFTDNTWGGRF-DMPREMAHSHLGMVTDGRYIYVVTGQYGP 183 (429)
Q Consensus 106 ~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~-~~~~yd~~~~~W~~~~-~~~~~~~r~~~~~~~~~~~lyv~GG~~~~ 183 (429)
...|.+|..|+++.+++++|||||........+ +++++|..+..|.... ....|.+|.+|+++.++++||+|||.+..
T Consensus 55 ~~~p~~R~~hs~~~~~~~~~vfGG~~~~~~~~~~dl~~~d~~~~~w~~~~~~g~~p~~r~g~~~~~~~~~l~lfGG~~~~ 134 (482)
T KOG0379|consen 55 GVGPIPRAGHSAVLIGNKLYVFGGYGSGDRLTDLDLYVLDLESQLWTKPAATGDEPSPRYGHSLSAVGDKLYLFGGTDKK 134 (482)
T ss_pred CCCcchhhccceeEECCEEEEECCCCCCCccccceeEEeecCCcccccccccCCCCCcccceeEEEECCeEEEEccccCC
Confidence 346889999999999999999999866544333 6999999999998753 33445689999999999999999999863
Q ss_pred CCCCCCceeEEEeCCCCceEeCC---CCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeec-
Q 014195 184 QCRGPTAHTFVLDTETKKWQDLP---PLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTE- 259 (429)
Q Consensus 184 ~~~~~~~~~~~yd~~t~~W~~~~---~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~- 259 (429)
. ..+++++.||+.|++|..+. ..|.+|.+|++++++++||||||.+...- +..+++.||.++.+|.++
T Consensus 135 ~--~~~~~l~~~d~~t~~W~~l~~~~~~P~~r~~Hs~~~~g~~l~vfGG~~~~~~------~~ndl~i~d~~~~~W~~~~ 206 (482)
T KOG0379|consen 135 Y--RNLNELHSLDLSTRTWSLLSPTGDPPPPRAGHSATVVGTKLVVFGGIGGTGD------SLNDLHIYDLETSTWSELD 206 (482)
T ss_pred C--CChhheEeccCCCCcEEEecCcCCCCCCcccceEEEECCEEEEECCccCccc------ceeeeeeeccccccceecc
Confidence 2 23889999999999999985 46899999999999999999999875441 223344456889999984
Q ss_pred --cCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcC---CCCCCCCCcc
Q 014195 260 --IPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLP---SMPKPDSHIE 333 (429)
Q Consensus 260 --~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~---~~~~~r~~~~ 333 (429)
.+.|.+|.+|++++++++++||||.... +.+++|+|.+| .+.+|..+. ..|.||..|.
T Consensus 207 ~~g~~P~pR~gH~~~~~~~~~~v~gG~~~~----------------~~~l~D~~~ldl~~~~W~~~~~~g~~p~~R~~h~ 270 (482)
T KOG0379|consen 207 TQGEAPSPRYGHAMVVVGNKLLVFGGGDDG----------------DVYLNDVHILDLSTWEWKLLPTGGDLPSPRSGHS 270 (482)
T ss_pred cCCCCCCCCCCceEEEECCeEEEEeccccC----------------CceecceEeeecccceeeeccccCCCCCCcceee
Confidence 4557788889999999999999998622 23789999999 899999765 4688888765
Q ss_pred eeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEec----ccCcceeeeeeEEEC
Q 014195 334 FAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIG----KLPYRVKTTLAGYWN 394 (429)
Q Consensus 334 ~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~----~lp~~r~~~~~~~~~ 394 (429)
.+..+.+++|+||...... ..+.++|.||.+++.|+.+. ..|.+|..++.....
T Consensus 271 --~~~~~~~~~l~gG~~~~~~-----~~l~~~~~l~~~~~~w~~~~~~~~~~~~~~~~~~~~~~~ 328 (482)
T KOG0379|consen 271 --LTVSGDHLLLFGGGTDPKQ-----EPLGDLYGLDLETLVWSKVESVGVVRPSPRLGHAAELID 328 (482)
T ss_pred --eEEECCEEEEEcCCccccc-----ccccccccccccccceeeeeccccccccccccccceeec
Confidence 4689999999999887511 03679999999999999984 345677666655444
No 24
>KOG0379 consensus Kelch repeat-containing proteins [General function prediction only]
Probab=99.96 E-value=6.5e-27 Score=230.31 Aligned_cols=231 Identities=23% Similarity=0.393 Sum_probs=185.8
Q ss_pred CCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC---CCCCCCCCceEEEECCEEEEEeCCCCCCC
Q 014195 159 EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP---PLPVPRYAPATQLWRGRLHVMGGSGENRY 235 (429)
Q Consensus 159 ~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~---~~p~~r~~~~~~~~~~~lyv~GG~~~~~~ 235 (429)
|.+|..|+++..++++|||||.......... +++++|..+..|.... ..|.+|.+|.++.++++||+|||.+. .+
T Consensus 58 p~~R~~hs~~~~~~~~~vfGG~~~~~~~~~~-dl~~~d~~~~~w~~~~~~g~~p~~r~g~~~~~~~~~l~lfGG~~~-~~ 135 (482)
T KOG0379|consen 58 PIPRAGHSAVLIGNKLYVFGGYGSGDRLTDL-DLYVLDLESQLWTKPAATGDEPSPRYGHSLSAVGDKLYLFGGTDK-KY 135 (482)
T ss_pred cchhhccceeEECCEEEEECCCCCCCccccc-eeEEeecCCcccccccccCCCCCcccceeEEEECCeEEEEccccC-CC
Confidence 5589999999999999999998766553222 6999999999999875 57789999999999999999999985 22
Q ss_pred CccccceEeeeecCCccccceeeccC---CCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEE
Q 014195 236 TPEVDHWSLAVKDGKPLEKEWRTEIP---IPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYM 312 (429)
Q Consensus 236 ~~~~~~~~~~~~~~d~~~~~W~~~~~---~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~ 312 (429)
....+.| .||+.+.+|....+ .|.+|.+|++++++++||||||.+.... ..+++|.
T Consensus 136 ~~~~~l~-----~~d~~t~~W~~l~~~~~~P~~r~~Hs~~~~g~~l~vfGG~~~~~~----------------~~ndl~i 194 (482)
T KOG0379|consen 136 RNLNELH-----SLDLSTRTWSLLSPTGDPPPPRAGHSATVVGTKLVVFGGIGGTGD----------------SLNDLHI 194 (482)
T ss_pred CChhheE-----eccCCCCcEEEecCcCCCCCCcccceEEEECCEEEEECCccCccc----------------ceeeeee
Confidence 2223333 44699999998533 4788888999999999999999875531 5789999
Q ss_pred eC-CCCCeEEcC---CCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEe---cccCcce
Q 014195 313 LD-DEMKWKVLP---SMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVI---GKLPYRV 385 (429)
Q Consensus 313 ~d-~~~~W~~~~---~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v---~~lp~~r 385 (429)
|| ++.+|.++. +.|.||..| ++++.+++++||||...... +++|+|++|..+.+|..+ +.+|.+|
T Consensus 195 ~d~~~~~W~~~~~~g~~P~pR~gH--~~~~~~~~~~v~gG~~~~~~------~l~D~~~ldl~~~~W~~~~~~g~~p~~R 266 (482)
T KOG0379|consen 195 YDLETSTWSELDTQGEAPSPRYGH--AMVVVGNKLLVFGGGDDGDV------YLNDVHILDLSTWEWKLLPTGGDLPSPR 266 (482)
T ss_pred eccccccceecccCCCCCCCCCCc--eEEEECCeEEEEeccccCCc------eecceEeeecccceeeeccccCCCCCCc
Confidence 99 999999986 356677755 56999999999999983332 799999999999999966 5789999
Q ss_pred eeeeeEEECCEEEEEcccCCCCCCCCCCccccccEEeeeee
Q 014195 386 KTTLAGYWNGWLYFTSGQRDKGPDDPAPRKVHGDMWRTKLL 426 (429)
Q Consensus 386 ~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~~~ 426 (429)
..|+++..+.+++++||...... ..+.|+|.+.++
T Consensus 267 ~~h~~~~~~~~~~l~gG~~~~~~------~~l~~~~~l~~~ 301 (482)
T KOG0379|consen 267 SGHSLTVSGDHLLLFGGGTDPKQ------EPLGDLYGLDLE 301 (482)
T ss_pred ceeeeEEECCEEEEEcCCccccc------cccccccccccc
Confidence 99999999999999999876411 124666666554
No 25
>KOG1230 consensus Protein containing repeated kelch motifs [General function prediction only]
Probab=99.95 E-value=3.9e-27 Score=212.59 Aligned_cols=256 Identities=20% Similarity=0.354 Sum_probs=196.6
Q ss_pred CCCCCCCccceeeEEEe--CCEEEEEeCeeCCCC-CCCCceeEEEeCCCCceEeC--CCCCCCCCCceEEEEC-CEEEEE
Q 014195 154 FDMPREMAHSHLGMVTD--GRYIYVVTGQYGPQC-RGPTAHTFVLDTETKKWQDL--PPLPVPRYAPATQLWR-GRLHVM 227 (429)
Q Consensus 154 ~~~~~~~~r~~~~~~~~--~~~lyv~GG~~~~~~-~~~~~~~~~yd~~t~~W~~~--~~~p~~r~~~~~~~~~-~~lyv~ 227 (429)
.+.|.|.+|.++++.+. .+.|++|||..-++. .-..++++.||..+++|..+ ++.|.||+.|+++++- |.+|+|
T Consensus 59 ~~~~~PspRsn~sl~~nPekeELilfGGEf~ngqkT~vYndLy~Yn~k~~eWkk~~spn~P~pRsshq~va~~s~~l~~f 138 (521)
T KOG1230|consen 59 TSVPPPSPRSNPSLFANPEKEELILFGGEFYNGQKTHVYNDLYSYNTKKNEWKKVVSPNAPPPRSSHQAVAVPSNILWLF 138 (521)
T ss_pred ccCCCCCCCCCcceeeccCcceeEEecceeecceeEEEeeeeeEEeccccceeEeccCCCcCCCccceeEEeccCeEEEe
Confidence 44556678999988876 568999999633221 12368999999999999998 4678999999999885 899999
Q ss_pred eCCCC----CCCCccccceEeeeecCCccccceeecc--CCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCcccccc
Q 014195 228 GGSGE----NRYTPEVDHWSLAVKDGKPLEKEWRTEI--PIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSR 301 (429)
Q Consensus 228 GG~~~----~~~~~~~~~~~~~~~~~d~~~~~W~~~~--~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~ 301 (429)
||--. ..+.--.+.|.+. ..+++|+++. --|.+|.+|-+++...+|++|||+... .
T Consensus 139 GGEfaSPnq~qF~HYkD~W~fd-----~~trkweql~~~g~PS~RSGHRMvawK~~lilFGGFhd~-------------n 200 (521)
T KOG1230|consen 139 GGEFASPNQEQFHHYKDLWLFD-----LKTRKWEQLEFGGGPSPRSGHRMVAWKRQLILFGGFHDS-------------N 200 (521)
T ss_pred ccccCCcchhhhhhhhheeeee-----eccchheeeccCCCCCCCccceeEEeeeeEEEEcceecC-------------C
Confidence 99632 3344456777764 8899999853 347778888999999999999998543 2
Q ss_pred CCeeeeCceEEeC-CCCCeEEcCC---CCCCCCCcceeEEEECCEEEEEcccCCCCC--CccceeeeCcEEEEecCC---
Q 014195 302 RNEVVYDDVYMLD-DEMKWKVLPS---MPKPDSHIEFAWVLVNNSIVIVGGTTEKHP--TTKKMVLVGEIFQFNLNT--- 372 (429)
Q Consensus 302 ~~~~~~~~v~~~d-~~~~W~~~~~---~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~--~~~~~~~~~~i~~yd~~~--- 372 (429)
..-.++||+|+|| ++-+|+++.+ -|.||+.+.++ +..+|.|||.||+..... ...+.+..+|+|.++|+.
T Consensus 201 r~y~YyNDvy~FdLdtykW~Klepsga~PtpRSGcq~~-vtpqg~i~vyGGYsK~~~kK~~dKG~~hsDmf~L~p~~~~~ 279 (521)
T KOG1230|consen 201 RDYIYYNDVYAFDLDTYKWSKLEPSGAGPTPRSGCQFS-VTPQGGIVVYGGYSKQRVKKDVDKGTRHSDMFLLKPEDGRE 279 (521)
T ss_pred CceEEeeeeEEEeccceeeeeccCCCCCCCCCCcceEE-ecCCCcEEEEcchhHhhhhhhhhcCceeeeeeeecCCcCCC
Confidence 2345899999999 9999999965 37888876542 555999999999975442 122455788999999998
Q ss_pred --CCeEEe---cccCcceeeeeeEE-ECCEEEEEcccCC-CCCCCCCCccccccEEeeeeecC
Q 014195 373 --LKWHVI---GKLPYRVKTTLAGY-WNGWLYFTSGQRD-KGPDDPAPRKVHGDMWRTKLLLN 428 (429)
Q Consensus 373 --~~W~~v---~~lp~~r~~~~~~~-~~~~i~v~GG~~~-~~~~~~~~~~~~~d~w~~~~~~~ 428 (429)
-.|+.+ +.-|.||.++++++ .+++-++|||.-+ ....+..-....||++.++|..|
T Consensus 280 dKw~W~kvkp~g~kPspRsgfsv~va~n~kal~FGGV~D~eeeeEsl~g~F~NDLy~fdlt~n 342 (521)
T KOG1230|consen 280 DKWVWTKVKPSGVKPSPRSGFSVAVAKNHKALFFGGVCDLEEEEESLSGEFFNDLYFFDLTRN 342 (521)
T ss_pred cceeEeeccCCCCCCCCCCceeEEEecCCceEEecceecccccchhhhhhhhhhhhheecccc
Confidence 478887 45689999988765 4559999999877 44444444667799999988765
No 26
>KOG4152 consensus Host cell transcription factor HCFC1 [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.95 E-value=7.2e-27 Score=215.75 Aligned_cols=310 Identities=15% Similarity=0.204 Sum_probs=221.4
Q ss_pred cccccCCCCCCCCceehhHHHHHHHHHHhhcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCC
Q 014195 3 RSFVGKNSTTPSPARVVLSIFVMILGFALVADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDV 82 (429)
Q Consensus 3 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~ 82 (429)
|-+++.-.+-|++|+. |.++++...|.+|||.+.. ..+.++.||..++++-+|.
T Consensus 20 rrV~~~tGPvPrpRHG--------HRAVaikELiviFGGGNEG-iiDELHvYNTatnqWf~Pa----------------- 73 (830)
T KOG4152|consen 20 RRVQQSTGPVPRPRHG--------HRAVAIKELIVIFGGGNEG-IIDELHVYNTATNQWFAPA----------------- 73 (830)
T ss_pred EEEecccCCCCCcccc--------chheeeeeeEEEecCCccc-chhhhhhhccccceeecch-----------------
Confidence 4567777788888886 8889999999999996532 4566677766665544443
Q ss_pred CcCcccccccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCC-----CC
Q 014195 83 VPKRILPATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFD-----MP 157 (429)
Q Consensus 83 ~~~~~~~~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~-----~~ 157 (429)
...+.|.+-..|+.+..+.+||+|||...-+...++++..-...-+|+++.+ -+
T Consensus 74 ---------------------vrGDiPpgcAA~GfvcdGtrilvFGGMvEYGkYsNdLYELQasRWeWkrlkp~~p~nG~ 132 (830)
T KOG4152|consen 74 ---------------------VRGDIPPGCAAFGFVCDGTRILVFGGMVEYGKYSNDLYELQASRWEWKRLKPKTPKNGP 132 (830)
T ss_pred ---------------------hcCCCCCchhhcceEecCceEEEEccEeeeccccchHHHhhhhhhhHhhcCCCCCCCCC
Confidence 1245677777888888899999999998777666655555555556666632 23
Q ss_pred CCCccceeeEEEeCCEEEEEeCeeCCCCC------CCCceeEEEeCCCC----ceEeC---CCCCCCCCCceEEEE----
Q 014195 158 REMAHSHLGMVTDGRYIYVVTGQYGPQCR------GPTAHTFVLDTETK----KWQDL---PPLPVPRYAPATQLW---- 220 (429)
Q Consensus 158 ~~~~r~~~~~~~~~~~lyv~GG~~~~~~~------~~~~~~~~yd~~t~----~W~~~---~~~p~~r~~~~~~~~---- 220 (429)
.|.+|-+|++.+.+++.|+|||...+... ..++|+|..++.-. .|... ..+|.+|-.|+++++
T Consensus 133 pPCPRlGHSFsl~gnKcYlFGGLaNdseDpknNvPrYLnDlY~leL~~Gsgvv~W~ip~t~Gv~P~pRESHTAViY~eKD 212 (830)
T KOG4152|consen 133 PPCPRLGHSFSLVGNKCYLFGGLANDSEDPKNNVPRYLNDLYILELRPGSGVVAWDIPITYGVLPPPRESHTAVIYTEKD 212 (830)
T ss_pred CCCCccCceeEEeccEeEEeccccccccCcccccchhhcceEEEEeccCCceEEEecccccCCCCCCcccceeEEEEecc
Confidence 36689999999999999999997543321 23778888887743 48765 378999999999988
Q ss_pred --CCEEEEEeCCCCCCCCccccceEeeeecCCccccceee-----ccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCC
Q 014195 221 --RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRT-----EIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPG 293 (429)
Q Consensus 221 --~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~-----~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~ 293 (429)
..++||+||..+-+ -.+.|.++ .++-+|.+ .+||||..+ +++.+++++|||||.-.--.....
T Consensus 213 s~~skmvvyGGM~G~R---LgDLW~Ld-----l~Tl~W~kp~~~G~~PlPRSLH--sa~~IGnKMyvfGGWVPl~~~~~~ 282 (830)
T KOG4152|consen 213 SKKSKMVVYGGMSGCR---LGDLWTLD-----LDTLTWNKPSLSGVAPLPRSLH--SATTIGNKMYVFGGWVPLVMDDVK 282 (830)
T ss_pred CCcceEEEEccccccc---ccceeEEe-----cceeecccccccCCCCCCcccc--cceeecceeEEecceeeeeccccc
Confidence 35799999998654 35778875 77888987 467777764 999999999999997432110000
Q ss_pred CCccccccCCeeeeCceEEeC-CCCCeEEcC-----CCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEE
Q 014195 294 SPIFKCSRRNEVVYDDVYMLD-DEMKWKVLP-----SMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQ 367 (429)
Q Consensus 294 ~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~-----~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~ 367 (429)
-...+..-...+.+-+++ +++.|+.+- .-..||.+.+++++.++.++||-.|+++....-....+..|+|.
T Consensus 283 ---~~~hekEWkCTssl~clNldt~~W~tl~~d~~ed~tiPR~RAGHCAvAigtRlYiWSGRDGYrKAwnnQVCCkDlWy 359 (830)
T KOG4152|consen 283 ---VATHEKEWKCTSSLACLNLDTMAWETLLMDTLEDNTIPRARAGHCAVAIGTRLYIWSGRDGYRKAWNNQVCCKDLWY 359 (830)
T ss_pred ---cccccceeeeccceeeeeecchheeeeeeccccccccccccccceeEEeccEEEEEeccchhhHhhccccchhhhhh
Confidence 000111222345566677 899999874 22467777788889999999999999987654333345678888
Q ss_pred EecCC
Q 014195 368 FNLNT 372 (429)
Q Consensus 368 yd~~~ 372 (429)
+|.+.
T Consensus 360 LdTek 364 (830)
T KOG4152|consen 360 LDTEK 364 (830)
T ss_pred hcccC
Confidence 87654
No 27
>COG3055 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=99.91 E-value=2.5e-22 Score=179.36 Aligned_cols=287 Identities=20% Similarity=0.309 Sum_probs=211.7
Q ss_pred EccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECC--CCceeeCCCCCCCCccceeeEEEeCCEEEEEeCee
Q 014195 104 KMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFT--DNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQY 181 (429)
Q Consensus 104 ~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~--~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~ 181 (429)
.+|++|++--.-+.+.+++.+||-=|..+. ..+..|.+ ...|++++..|.. +|.....++++++||+|||..
T Consensus 29 ~lPdlPvg~KnG~Ga~ig~~~YVGLGs~G~-----afy~ldL~~~~k~W~~~a~FpG~-~rnqa~~a~~~~kLyvFgG~G 102 (381)
T COG3055 29 QLPDLPVGFKNGAGALIGDTVYVGLGSAGT-----AFYVLDLKKPGKGWTKIADFPGG-ARNQAVAAVIGGKLYVFGGYG 102 (381)
T ss_pred cCCCCCccccccccceecceEEEEeccCCc-----cceehhhhcCCCCceEcccCCCc-ccccchheeeCCeEEEeeccc
Confidence 458888887777888889999997774443 25566665 4579999999975 699999999999999999975
Q ss_pred CCCC--CCCCceeEEEeCCCCceEeCC-CCCCCCCCceEEEECC-EEEEEeCCCCC------------------------
Q 014195 182 GPQC--RGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQLWRG-RLHVMGGSGEN------------------------ 233 (429)
Q Consensus 182 ~~~~--~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~~~~~-~lyv~GG~~~~------------------------ 233 (429)
.... ....+++++|||.+++|+++. ..|.....++++.+++ +||++||.+..
T Consensus 103 k~~~~~~~~~nd~Y~y~p~~nsW~kl~t~sP~gl~G~~~~~~~~~~i~f~GGvn~~if~~yf~dv~~a~~d~~~~~~i~~ 182 (381)
T COG3055 103 KSVSSSPQVFNDAYRYDPSTNSWHKLDTRSPTGLVGASTFSLNGTKIYFFGGVNQNIFNGYFEDVGAAGKDKEAVDKIIA 182 (381)
T ss_pred cCCCCCceEeeeeEEecCCCChhheeccccccccccceeEecCCceEEEEccccHHhhhhhHHhhhhhcccHHHHHHHHH
Confidence 4433 344789999999999999997 4566778888888887 99999998621
Q ss_pred ---CCCccccceEeeeecCCccccceeeccCCCCC-CCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCc
Q 014195 234 ---RYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRG-GPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDD 309 (429)
Q Consensus 234 ---~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~-~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~ 309 (429)
...+....|+-++-.|+|.+++|+.....|-. .++++++.-+++|.++-|+-... .++.++ .
T Consensus 183 ~yf~~~~~dy~~n~ev~sy~p~~n~W~~~G~~pf~~~aGsa~~~~~n~~~lInGEiKpG-----------LRt~~~---k 248 (381)
T COG3055 183 HYFDKKAEDYFFNKEVLSYDPSTNQWRNLGENPFYGNAGSAVVIKGNKLTLINGEIKPG-----------LRTAEV---K 248 (381)
T ss_pred HHhCCCHHHhcccccccccccccchhhhcCcCcccCccCcceeecCCeEEEEcceecCC-----------ccccce---e
Confidence 01234445666677788999999997766533 33345555688899999985443 222221 2
Q ss_pred eEEeC-CCCCeEEcCCCCCCCCCccee-----EEEECCEEEEEcccCCCCCC------------ccceeeeCcEEEEecC
Q 014195 310 VYMLD-DEMKWKVLPSMPKPDSHIEFA-----WVLVNNSIVIVGGTTEKHPT------------TKKMVLVGEIFQFNLN 371 (429)
Q Consensus 310 v~~~d-~~~~W~~~~~~~~~r~~~~~~-----~~~~~~~i~v~GG~~~~~~~------------~~~~~~~~~i~~yd~~ 371 (429)
.+.+. ...+|..++++|.|.+...-. .-..++.+++.||.+..+.. -..+.+.++||.+|
T Consensus 249 ~~~~~~~~~~w~~l~~lp~~~~~~~eGvAGaf~G~s~~~~lv~GGAnF~Ga~~~y~~Gk~~AH~Gl~K~w~~~Vy~~d-- 326 (381)
T COG3055 249 QADFGGDNLKWLKLSDLPAPIGSNKEGVAGAFSGKSNGEVLVAGGANFPGALKAYKNGKFYAHEGLSKSWNSEVYIFD-- 326 (381)
T ss_pred EEEeccCceeeeeccCCCCCCCCCccccceeccceeCCeEEEecCCCChhHHHHHHhcccccccchhhhhhceEEEEc--
Confidence 33444 577999999888776543111 13567899999998763321 01234678999998
Q ss_pred CCCeEEecccCcceeeeeeEEECCEEEEEcccCCCCCCCCC
Q 014195 372 TLKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDPA 412 (429)
Q Consensus 372 ~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~~ 412 (429)
.+.|+.+++||.++.+..++..++++|++||+...|..+.+
T Consensus 327 ~g~Wk~~GeLp~~l~YG~s~~~nn~vl~IGGE~~~Gka~~~ 367 (381)
T COG3055 327 NGSWKIVGELPQGLAYGVSLSYNNKVLLIGGETSGGKATTR 367 (381)
T ss_pred CCceeeecccCCCccceEEEecCCcEEEEccccCCCeeeee
Confidence 99999999999999999999999999999999887755544
No 28
>COG3055 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=99.86 E-value=4.3e-20 Score=165.20 Aligned_cols=264 Identities=20% Similarity=0.262 Sum_probs=183.9
Q ss_pred cccccCCCeEEccCCC-CCccCCcEEEECCEEEEEeccCCC----CceeeeEEEEECCCCceeeCCCCCCCCccceeeEE
Q 014195 94 DLPAPELKWEKMKAAP-VPRLDGAAIQIKNLLYVFAGYGSI----DYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMV 168 (429)
Q Consensus 94 ~~d~~~~~W~~~~~~p-~~R~~~~~~~~~~~iyv~GG~~~~----~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~ 168 (429)
..+.....|++++.+| .+|.+...++++++||+|||.... .+..+++++|||.+|+|+++.... |..-..++++
T Consensus 64 dL~~~~k~W~~~a~FpG~~rnqa~~a~~~~kLyvFgG~Gk~~~~~~~~~nd~Y~y~p~~nsW~kl~t~s-P~gl~G~~~~ 142 (381)
T COG3055 64 DLKKPGKGWTKIADFPGGARNQAVAAVIGGKLYVFGGYGKSVSSSPQVFNDAYRYDPSTNSWHKLDTRS-PTGLVGASTF 142 (381)
T ss_pred hhhcCCCCceEcccCCCcccccchheeeCCeEEEeeccccCCCCCceEeeeeEEecCCCChhheecccc-ccccccceeE
Confidence 3345667999999998 579999999999999999998543 357789999999999999986543 2245677777
Q ss_pred EeCC-EEEEEeCeeCC-------------------------------CCCCCCceeEEEeCCCCceEeCCCCC-CCCCCc
Q 014195 169 TDGR-YIYVVTGQYGP-------------------------------QCRGPTAHTFVLDTETKKWQDLPPLP-VPRYAP 215 (429)
Q Consensus 169 ~~~~-~lyv~GG~~~~-------------------------------~~~~~~~~~~~yd~~t~~W~~~~~~p-~~r~~~ 215 (429)
.+++ +||++||.+.. .......++..|||.+++|+.+...| .+++++
T Consensus 143 ~~~~~~i~f~GGvn~~if~~yf~dv~~a~~d~~~~~~i~~~yf~~~~~dy~~n~ev~sy~p~~n~W~~~G~~pf~~~aGs 222 (381)
T COG3055 143 SLNGTKIYFFGGVNQNIFNGYFEDVGAAGKDKEAVDKIIAHYFDKKAEDYFFNKEVLSYDPSTNQWRNLGENPFYGNAGS 222 (381)
T ss_pred ecCCceEEEEccccHHhhhhhHHhhhhhcccHHHHHHHHHHHhCCCHHHhcccccccccccccchhhhcCcCcccCccCc
Confidence 8777 99999997431 11123567899999999999998777 677887
Q ss_pred eEEEECCEEEEEeCCCCCC-CCccccceEeeeecCCccccceeeccCCCCCC-------CceeEEEeCCEEEEEcccCCC
Q 014195 216 ATQLWRGRLHVMGGSGENR-YTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGG-------PHRACVVVDDRLLVIGGQEGD 287 (429)
Q Consensus 216 ~~~~~~~~lyv~GG~~~~~-~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~-------~~~~~~~~~~~iyv~GG~~~~ 287 (429)
+.+.-++++.++-|.-... ..+.+.+.++ .-...+|..++++|... +++-.-..++.+.|.||.+-.
T Consensus 223 a~~~~~n~~~lInGEiKpGLRt~~~k~~~~-----~~~~~~w~~l~~lp~~~~~~~eGvAGaf~G~s~~~~lv~GGAnF~ 297 (381)
T COG3055 223 AVVIKGNKLTLINGEIKPGLRTAEVKQADF-----GGDNLKWLKLSDLPAPIGSNKEGVAGAFSGKSNGEVLVAGGANFP 297 (381)
T ss_pred ceeecCCeEEEEcceecCCccccceeEEEe-----ccCceeeeeccCCCCCCCCCccccceeccceeCCeEEEecCCCCh
Confidence 7777788899998864221 2223333333 25677899987665332 222233458889999997644
Q ss_pred CCCCCCCCccccccC--CeeeeCceEEeCCCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcE
Q 014195 288 FMAKPGSPIFKCSRR--NEVVYDDVYMLDDEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEI 365 (429)
Q Consensus 288 ~~~~~~~~~~~~~~~--~~~~~~~v~~~d~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i 365 (429)
+..+.+...+-..+. .....++||.+| .+.|+.+..||.++.+- . .+..++.||++||++..+. .+.++
T Consensus 298 Ga~~~y~~Gk~~AH~Gl~K~w~~~Vy~~d-~g~Wk~~GeLp~~l~YG-~-s~~~nn~vl~IGGE~~~Gk------a~~~v 368 (381)
T COG3055 298 GALKAYKNGKFYAHEGLSKSWNSEVYIFD-NGSWKIVGELPQGLAYG-V-SLSYNNKVLLIGGETSGGK------ATTRV 368 (381)
T ss_pred hHHHHHHhcccccccchhhhhhceEEEEc-CCceeeecccCCCccce-E-EEecCCcEEEEccccCCCe------eeeeE
Confidence 322111111111111 233677899995 99999999999988763 3 4888999999999998775 34455
Q ss_pred EEEecCC
Q 014195 366 FQFNLNT 372 (429)
Q Consensus 366 ~~yd~~~ 372 (429)
+.+-.+.
T Consensus 369 ~~l~~~g 375 (381)
T COG3055 369 YSLSWDG 375 (381)
T ss_pred EEEEEcC
Confidence 5544333
No 29
>KOG2437 consensus Muskelin [Signal transduction mechanisms]
Probab=99.66 E-value=1.3e-17 Score=154.64 Aligned_cols=301 Identities=16% Similarity=0.217 Sum_probs=192.1
Q ss_pred CCCeEEccC----------CCCCccCCcEEEECC--EEEEEeccCCCCceeeeEEEEECCCCceeeCCC---CCCCCccc
Q 014195 99 ELKWEKMKA----------APVPRLDGAAIQIKN--LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFD---MPREMAHS 163 (429)
Q Consensus 99 ~~~W~~~~~----------~p~~R~~~~~~~~~~--~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~---~~~~~~r~ 163 (429)
...|.++.. -|..|.+|.++...+ -||+.||+++-+. +.++|.|+...+.|+.+.. .|. .|.
T Consensus 238 ~~~W~~i~~~~~~~~~~~~~p~~RgGHQMV~~~~~~CiYLYGGWdG~~~-l~DFW~Y~v~e~~W~~iN~~t~~PG--~Rs 314 (723)
T KOG2437|consen 238 KPRWSQIIPKSTKGDGEDNRPGMRGGHQMVIDVQTECVYLYGGWDGTQD-LADFWAYSVKENQWTCINRDTEGPG--ARS 314 (723)
T ss_pred cccccccCchhhcccccccCccccCcceEEEeCCCcEEEEecCcccchh-HHHHHhhcCCcceeEEeecCCCCCc--chh
Confidence 457877642 256799999998855 8999999999876 4669999999999998743 444 799
Q ss_pred eeeEEEeCC--EEEEEeCeeCCCCC---CCCceeEEEeCCCCceEeCC------CCCCCCCCceEEEECCE--EEEEeCC
Q 014195 164 HLGMVTDGR--YIYVVTGQYGPQCR---GPTAHTFVLDTETKKWQDLP------PLPVPRYAPATQLWRGR--LHVMGGS 230 (429)
Q Consensus 164 ~~~~~~~~~--~lyv~GG~~~~~~~---~~~~~~~~yd~~t~~W~~~~------~~p~~r~~~~~~~~~~~--lyv~GG~ 230 (429)
.|-+++.-. +||++|-+-+.+.. ..-+++|+||.+++.|..+. .-|.....|.+++.+++ |||+||+
T Consensus 315 CHRMVid~S~~KLYLlG~Y~~sS~r~~~s~RsDfW~FDi~~~~W~~ls~dt~~dGGP~~vfDHqM~Vd~~k~~iyVfGGr 394 (723)
T KOG2437|consen 315 CHRMVIDISRRKLYLLGRYLDSSVRNSKSLRSDFWRFDIDTNTWMLLSEDTAADGGPKLVFDHQMCVDSEKHMIYVFGGR 394 (723)
T ss_pred hhhhhhhhhHhHHhhhhhccccccccccccccceEEEecCCceeEEecccccccCCcceeecceeeEecCcceEEEecCe
Confidence 999998865 99999987544322 23579999999999999885 24677899999999888 9999998
Q ss_pred CCCCCCccccceEeeeecCCccccceeeccCC----------CCCCCceeE--EEeCCEEEEEcccCCCCCCCCCCCccc
Q 014195 231 GENRYTPEVDHWSLAVKDGKPLEKEWRTEIPI----------PRGGPHRAC--VVVDDRLLVIGGQEGDFMAKPGSPIFK 298 (429)
Q Consensus 231 ~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~----------p~~~~~~~~--~~~~~~iyv~GG~~~~~~~~~~~~~~~ 298 (429)
.-.. ...+|. -+|.||.....|.....- ...|.+|++ ..-+.++|++||.....
T Consensus 395 ~~~~---~e~~f~-GLYaf~~~~~~w~~l~e~~~~~~~vvE~~~sR~ghcmE~~~~n~~ly~fggq~s~~---------- 460 (723)
T KOG2437|consen 395 ILTC---NEPQFS-GLYAFNCQCQTWKLLREDSCNAGPVVEDIQSRIGHCMEFHSKNRCLYVFGGQRSKT---------- 460 (723)
T ss_pred eccC---CCcccc-ceEEEecCCccHHHHHHHHhhcCcchhHHHHHHHHHHHhcCCCCeEEeccCcccce----------
Confidence 6332 112222 134455778888763221 122333333 34477799999975432
Q ss_pred cccCCeeeeCceEEeC-CCCCeEEc-------CCCCCCCCCccee-EEEECCEEEEEcccCCCCCCccceeeeCcEEEEe
Q 014195 299 CSRRNEVVYDDVYMLD-DEMKWKVL-------PSMPKPDSHIEFA-WVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFN 369 (429)
Q Consensus 299 ~~~~~~~~~~~v~~~d-~~~~W~~~-------~~~~~~r~~~~~~-~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd 369 (429)
-++-.+.|| ....=..+ +++...+....-+ .-...++|.+.-|........ +....+.+|+|+
T Consensus 461 -------El~L~f~y~I~~E~~~~~s~~~k~dsS~~pS~~f~qRs~~dp~~~~i~~~~G~~~~~~~~-e~~~rns~wi~~ 532 (723)
T KOG2437|consen 461 -------ELNLFFSYDIDSEHVDIISDGTKKDSSMVPSTGFTQRATIDPELNEIHVLSGLSKDKEKR-EENVRNSFWIYD 532 (723)
T ss_pred -------EEeehhcceeccccchhhhccCcCccccCCCcchhhhcccCCCCcchhhhcccchhccCc-cccccCcEEEEE
Confidence 122334443 22111111 1111111111111 112245677777765432211 112567899999
Q ss_pred cCCCCeEEecc------------------------cCcceeeeeeE--EECCEEEEEcccCCCCCCCCCCccccccEEee
Q 014195 370 LNTLKWHVIGK------------------------LPYRVKTTLAG--YWNGWLYFTSGQRDKGPDDPAPRKVHGDMWRT 423 (429)
Q Consensus 370 ~~~~~W~~v~~------------------------lp~~r~~~~~~--~~~~~i~v~GG~~~~~~~~~~~~~~~~d~w~~ 423 (429)
..++.|..+.+ ++.+|..|+.+ ....-+|++||... ..+.|..+++|+|.+
T Consensus 533 i~~~~w~cI~~I~~~~~d~dtvfsvpFp~ks~~~~~~~~rf~h~~~~dL~~~~~yl~Ggn~~---~~~~~~m~l~dfW~l 609 (723)
T KOG2437|consen 533 IVRNSWSCIYKIDQAAKDNDTVFSVPFPTKSLQEEEPCPRFAHQLVYDLLHKVHYLFGGNPG---KSCSPKMRLDDFWSL 609 (723)
T ss_pred ecccchhhHhhhHHhhccCCceeeccCCcccccceeccccchhHHHHHHhhhhhhhhcCCCC---CCCCchhhhhhHHHH
Confidence 99999976521 34445555432 34467899999754 455666788999999
Q ss_pred eeec
Q 014195 424 KLLL 427 (429)
Q Consensus 424 ~~~~ 427 (429)
+|.-
T Consensus 610 ~I~r 613 (723)
T KOG2437|consen 610 KICR 613 (723)
T ss_pred hhcc
Confidence 8753
No 30
>KOG2437 consensus Muskelin [Signal transduction mechanisms]
Probab=99.57 E-value=1.6e-17 Score=153.90 Aligned_cols=343 Identities=13% Similarity=0.125 Sum_probs=203.2
Q ss_pred HHHHHHHHHHhhcc--eeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCcceeeeecCCCCcCccccccccccccc
Q 014195 21 SIFVMILGFALVAD--FFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAP 98 (429)
Q Consensus 21 ~~~~~~~~~~~~~~--~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~ 98 (429)
+-.++.|.++.... +||+.||++|-+.+.++..|+ ..
T Consensus 258 p~~RgGHQMV~~~~~~CiYLYGGWdG~~~l~DFW~Y~-----------------------------------------v~ 296 (723)
T KOG2437|consen 258 PGMRGGHQMVIDVQTECVYLYGGWDGTQDLADFWAYS-----------------------------------------VK 296 (723)
T ss_pred ccccCcceEEEeCCCcEEEEecCcccchhHHHHHhhc-----------------------------------------CC
Confidence 34567888988877 999999999988777666664 45
Q ss_pred CCCeEEcc---CCCCCccCCcEEEECC--EEEEEeccCCCC-----ceeeeEEEEECCCCceeeCCCC----CCCCccce
Q 014195 99 ELKWEKMK---AAPVPRLDGAAIQIKN--LLYVFAGYGSID-----YVHSHVDIYNFTDNTWGGRFDM----PREMAHSH 164 (429)
Q Consensus 99 ~~~W~~~~---~~p~~R~~~~~~~~~~--~iyv~GG~~~~~-----~~~~~~~~yd~~~~~W~~~~~~----~~~~~r~~ 164 (429)
++.|..+. ..|.+|..|.++..-. ++|+.|-+-+.. ...+++|+||..++.|..+.-- -.|..-..
T Consensus 297 e~~W~~iN~~t~~PG~RsCHRMVid~S~~KLYLlG~Y~~sS~r~~~s~RsDfW~FDi~~~~W~~ls~dt~~dGGP~~vfD 376 (723)
T KOG2437|consen 297 ENQWTCINRDTEGPGARSCHRMVIDISRRKLYLLGRYLDSSVRNSKSLRSDFWRFDIDTNTWMLLSEDTAADGGPKLVFD 376 (723)
T ss_pred cceeEEeecCCCCCcchhhhhhhhhhhHhHHhhhhhccccccccccccccceEEEecCCceeEEecccccccCCcceeec
Confidence 66777653 4688999999998755 999999874321 2456899999999999976311 22446778
Q ss_pred eeEEEeCCE--EEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC----------CCCCCCCceEEE--ECCEEEEEeCC
Q 014195 165 LGMVTDGRY--IYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP----------LPVPRYAPATQL--WRGRLHVMGGS 230 (429)
Q Consensus 165 ~~~~~~~~~--lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~----------~p~~r~~~~~~~--~~~~lyv~GG~ 230 (429)
|.+++.+++ |||+||+.-.........++.||.....|..+.. ....|.+|.+-. -++.+|++||.
T Consensus 377 HqM~Vd~~k~~iyVfGGr~~~~~e~~f~GLYaf~~~~~~w~~l~e~~~~~~~vvE~~~sR~ghcmE~~~~n~~ly~fggq 456 (723)
T KOG2437|consen 377 HQMCVDSEKHMIYVFGGRILTCNEPQFSGLYAFNCQCQTWKLLREDSCNAGPVVEDIQSRIGHCMEFHSKNRCLYVFGGQ 456 (723)
T ss_pred ceeeEecCcceEEEecCeeccCCCccccceEEEecCCccHHHHHHHHhhcCcchhHHHHHHHHHHHhcCCCCeEEeccCc
Confidence 999999887 9999998554433337789999999999998752 123566666544 36789999997
Q ss_pred CCCCCCccccceEeeeecCCccccceee-ccCC-CCCCC--ceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeee
Q 014195 231 GENRYTPEVDHWSLAVKDGKPLEKEWRT-EIPI-PRGGP--HRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVV 306 (429)
Q Consensus 231 ~~~~~~~~~~~~~~~~~~~d~~~~~W~~-~~~~-p~~~~--~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~ 306 (429)
....-..-.-.|++..+..+... .-++ .+++ |.... ....-.-...|.+.-|.+.... ...+..
T Consensus 457 ~s~~El~L~f~y~I~~E~~~~~s-~~~k~dsS~~pS~~f~qRs~~dp~~~~i~~~~G~~~~~~-----------~~e~~~ 524 (723)
T KOG2437|consen 457 RSKTELNLFFSYDIDSEHVDIIS-DGTKKDSSMVPSTGFTQRATIDPELNEIHVLSGLSKDKE-----------KREENV 524 (723)
T ss_pred ccceEEeehhcceeccccchhhh-ccCcCccccCCCcchhhhcccCCCCcchhhhcccchhcc-----------Cccccc
Confidence 64321111112221111110000 0000 1111 11110 0011112344666555543321 111224
Q ss_pred eCceEEeC-CCCCeEEcC------------------------CCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceee
Q 014195 307 YDDVYMLD-DEMKWKVLP------------------------SMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVL 361 (429)
Q Consensus 307 ~~~v~~~d-~~~~W~~~~------------------------~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~ 361 (429)
.+..|.|+ .++.|..+. .++.+|..+...+.+...-+|++||.-+....... .
T Consensus 525 rns~wi~~i~~~~w~cI~~I~~~~~d~dtvfsvpFp~ks~~~~~~~~rf~h~~~~dL~~~~~yl~Ggn~~~~~~~~m--~ 602 (723)
T KOG2437|consen 525 RNSFWIYDIVRNSWSCIYKIDQAAKDNDTVFSVPFPTKSLQEEEPCPRFAHQLVYDLLHKVHYLFGGNPGKSCSPKM--R 602 (723)
T ss_pred cCcEEEEEecccchhhHhhhHHhhccCCceeeccCCcccccceeccccchhHHHHHHhhhhhhhhcCCCCCCCCchh--h
Confidence 45566666 666665442 12445555544445566789999998665432211 2
Q ss_pred eCcEEEEecCCCCeEE---ecccCcceeeeeeEEECCEEEEEcccCCCCCCCCCCccccccEEeeee
Q 014195 362 VGEIFQFNLNTLKWHV---IGKLPYRVKTTLAGYWNGWLYFTSGQRDKGPDDPAPRKVHGDMWRTKL 425 (429)
Q Consensus 362 ~~~i~~yd~~~~~W~~---v~~lp~~r~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~d~w~~~~ 425 (429)
+++.|..++- +|.. +...+.+++.|......+..+++||.-. +++.. +.+|+|-+++
T Consensus 603 l~dfW~l~I~--rp~~~~~l~~~~~~~~~HrF~E~~~~~~l~a~~yl--q~~~~---~~~D~s~~~~ 662 (723)
T KOG2437|consen 603 LDDFWSLKIC--RPSKDYLLRHCKYLIRKHRFEEKAQVDPLSALKYL--QNDLY---ITVDHSDPEE 662 (723)
T ss_pred hhhHHHHhhc--ccchhhhhhcchhhhHHHHHHHHhhhhhHHHhHhh--hhcce---eccccCchhh
Confidence 4455544443 4433 2344556666766677888899988543 22222 2367776554
No 31
>PF13964 Kelch_6: Kelch motif
Probab=99.32 E-value=3.8e-12 Score=84.57 Aligned_cols=49 Identities=31% Similarity=0.562 Sum_probs=44.7
Q ss_pred CccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCC
Q 014195 111 PRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPRE 159 (429)
Q Consensus 111 ~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~ 159 (429)
||.+|++++++++|||+||........+++++||+++++|+++++||.|
T Consensus 1 pR~~~s~v~~~~~iyv~GG~~~~~~~~~~v~~yd~~t~~W~~~~~mp~p 49 (50)
T PF13964_consen 1 PRYGHSAVVVGGKIYVFGGYDNSGKYSNDVERYDPETNTWEQLPPMPTP 49 (50)
T ss_pred CCccCEEEEECCEEEEECCCCCCCCccccEEEEcCCCCcEEECCCCCCC
Confidence 6899999999999999999988555678899999999999999999983
No 32
>PF13964 Kelch_6: Kelch motif
Probab=99.32 E-value=4.4e-12 Score=84.23 Aligned_cols=50 Identities=32% Similarity=0.517 Sum_probs=44.9
Q ss_pred ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCC
Q 014195 161 AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPR 212 (429)
Q Consensus 161 ~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r 212 (429)
+|.+|+++.++++|||+||.... ....+++++||+++++|+.+++||.||
T Consensus 1 pR~~~s~v~~~~~iyv~GG~~~~--~~~~~~v~~yd~~t~~W~~~~~mp~pR 50 (50)
T PF13964_consen 1 PRYGHSAVVVGGKIYVFGGYDNS--GKYSNDVERYDPETNTWEQLPPMPTPR 50 (50)
T ss_pred CCccCEEEEECCEEEEECCCCCC--CCccccEEEEcCCCCcEEECCCCCCCC
Confidence 48899999999999999998775 234899999999999999999999987
No 33
>PF01344 Kelch_1: Kelch motif; InterPro: IPR006652 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding; PDB: 2XN4_A 2WOZ_A 3II7_A 4ASC_A 1U6D_X 1ZGK_A 2FLU_X 2VPJ_A 2DYH_A 1X2R_A ....
Probab=99.17 E-value=3.2e-11 Score=79.03 Aligned_cols=47 Identities=34% Similarity=0.604 Sum_probs=42.8
Q ss_pred CccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCC
Q 014195 111 PRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMP 157 (429)
Q Consensus 111 ~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~ 157 (429)
||.+|++++++++|||+||.+......+++++||+.+++|+.+++||
T Consensus 1 pR~~~~~~~~~~~iyv~GG~~~~~~~~~~v~~yd~~~~~W~~~~~mp 47 (47)
T PF01344_consen 1 PRSGHAAVVVGNKIYVIGGYDGNNQPTNSVEVYDPETNTWEELPPMP 47 (47)
T ss_dssp -BBSEEEEEETTEEEEEEEBESTSSBEEEEEEEETTTTEEEEEEEES
T ss_pred CCccCEEEEECCEEEEEeeecccCceeeeEEEEeCCCCEEEEcCCCC
Confidence 68999999999999999999886667889999999999999998886
No 34
>PF01344 Kelch_1: Kelch motif; InterPro: IPR006652 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding; PDB: 2XN4_A 2WOZ_A 3II7_A 4ASC_A 1U6D_X 1ZGK_A 2FLU_X 2VPJ_A 2DYH_A 1X2R_A ....
Probab=99.05 E-value=2.3e-10 Score=74.92 Aligned_cols=47 Identities=40% Similarity=0.690 Sum_probs=41.4
Q ss_pred ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCC
Q 014195 161 AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLP 209 (429)
Q Consensus 161 ~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p 209 (429)
||.+|++++++++|||+||.+.... .++++++||+.+++|+.+++||
T Consensus 1 pR~~~~~~~~~~~iyv~GG~~~~~~--~~~~v~~yd~~~~~W~~~~~mp 47 (47)
T PF01344_consen 1 PRSGHAAVVVGNKIYVIGGYDGNNQ--PTNSVEVYDPETNTWEELPPMP 47 (47)
T ss_dssp -BBSEEEEEETTEEEEEEEBESTSS--BEEEEEEEETTTTEEEEEEEES
T ss_pred CCccCEEEEECCEEEEEeeecccCc--eeeeEEEEeCCCCEEEEcCCCC
Confidence 5889999999999999999988332 3899999999999999999886
No 35
>PF13418 Kelch_4: Galactose oxidase, central domain; PDB: 2UVK_B.
Probab=99.04 E-value=2.5e-10 Score=75.40 Aligned_cols=47 Identities=34% Similarity=0.569 Sum_probs=32.4
Q ss_pred CccCCcEEEE-CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCC
Q 014195 111 PRLDGAAIQI-KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMP 157 (429)
Q Consensus 111 ~R~~~~~~~~-~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~ 157 (429)
||.+|+++.+ +++|||+||.+.....++++|+||+++++|++++++|
T Consensus 1 pR~~h~~~~~~~~~i~v~GG~~~~~~~~~d~~~~d~~~~~W~~~~~~P 48 (49)
T PF13418_consen 1 PRYGHSAVSIGDNSIYVFGGRDSSGSPLNDLWIFDIETNTWTRLPSMP 48 (49)
T ss_dssp --BS-EEEEE-TTEEEEE--EEE-TEE---EEEEETTTTEEEE--SS-
T ss_pred CcceEEEEEEeCCeEEEECCCCCCCcccCCEEEEECCCCEEEECCCCC
Confidence 6999999999 5899999999887777899999999999999998776
No 36
>PF13415 Kelch_3: Galactose oxidase, central domain
Probab=99.00 E-value=8.3e-10 Score=72.79 Aligned_cols=49 Identities=24% Similarity=0.462 Sum_probs=42.0
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEE
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLW 220 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~ 220 (429)
+++|||+||.+... ...++++|+||+.+++|++++++|.+|..|+++++
T Consensus 1 g~~~~vfGG~~~~~-~~~~nd~~~~~~~~~~W~~~~~~P~~R~~h~~~~i 49 (49)
T PF13415_consen 1 GNKLYVFGGYDDDG-GTRLNDVWVFDLDTNTWTRIGDLPPPRSGHTATVI 49 (49)
T ss_pred CCEEEEECCcCCCC-CCEecCEEEEECCCCEEEECCCCCCCccceEEEEC
Confidence 57899999998322 23389999999999999999999999999999864
No 37
>PF07646 Kelch_2: Kelch motif; InterPro: IPR011498 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding
Probab=98.98 E-value=1.2e-09 Score=72.03 Aligned_cols=47 Identities=26% Similarity=0.482 Sum_probs=41.3
Q ss_pred CccCCcEEEECCEEEEEecc--CCCCceeeeEEEEECCCCceeeCCCCC
Q 014195 111 PRLDGAAIQIKNLLYVFAGY--GSIDYVHSHVDIYNFTDNTWGGRFDMP 157 (429)
Q Consensus 111 ~R~~~~~~~~~~~iyv~GG~--~~~~~~~~~~~~yd~~~~~W~~~~~~~ 157 (429)
||.+|++++++++|||+||. +......+++++||+++++|+.+++++
T Consensus 1 ~r~~hs~~~~~~kiyv~GG~~~~~~~~~~~~v~~~d~~t~~W~~~~~~g 49 (49)
T PF07646_consen 1 PRYGHSAVVLDGKIYVFGGYGTDNGGSSSNDVWVFDTETNQWTELSPMG 49 (49)
T ss_pred CccceEEEEECCEEEEECCcccCCCCcccceeEEEECCCCEEeecCCCC
Confidence 68999999999999999999 444456788999999999999998774
No 38
>PF13415 Kelch_3: Galactose oxidase, central domain
Probab=98.96 E-value=1.9e-09 Score=71.01 Aligned_cols=48 Identities=29% Similarity=0.412 Sum_probs=41.5
Q ss_pred CCEEEEEeccC-CCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe
Q 014195 121 KNLLYVFAGYG-SIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD 170 (429)
Q Consensus 121 ~~~iyv~GG~~-~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~ 170 (429)
+++|||+||.+ .....++++|+||+.+++|++++++|. +|.+|+++++
T Consensus 1 g~~~~vfGG~~~~~~~~~nd~~~~~~~~~~W~~~~~~P~--~R~~h~~~~i 49 (49)
T PF13415_consen 1 GNKLYVFGGYDDDGGTRLNDVWVFDLDTNTWTRIGDLPP--PRSGHTATVI 49 (49)
T ss_pred CCEEEEECCcCCCCCCEecCEEEEECCCCEEEECCCCCC--CccceEEEEC
Confidence 57899999998 455678999999999999999988877 7999998863
No 39
>PF07646 Kelch_2: Kelch motif; InterPro: IPR011498 Kelch is a 50-residue motif, named after the Drosophila mutant in which it was first identified []. This sequence motif represents one beta-sheet blade, and several of these repeats can associate to form a beta-propeller. For instance, the motif appears 6 times in Drosophila egg-chamber regulatory protein, creating a 6-bladed beta-propeller. The motif is also found in mouse protein MIPP [] and in a number of poxviruses. In addition, kelch repeats have been recognised in alpha- and beta-scruin [, ], and in galactose oxidase from the fungus Dactylium dendroides [, ]. The structure of galactose oxidase reveals that the repeated sequence corresponds to a 4-stranded anti-parallel beta-sheet motif that forms the repeat unit in a super-barrel structural fold []. The known functions of kelch-containing proteins are diverse: scruin is an actin cross-linking protein; galactose oxidase catalyses the oxidation of the hydroxyl group at the C6 position in D-galactose; neuraminidase hydrolyses sialic acid residues from glycoproteins; and kelch may have a cytoskeletal function, as it is localised to the actin-rich ring canals that connect the 15 nurse cells to the developing oocyte in Drosophila []. Nevertheless, based on the location of the kelch pattern in the catalytic unit in galactose oxidase, functionally important residues have been predicted in glyoxal oxidase []. This entry represents a type of kelch sequence motif that comprises one beta-sheet blade.; GO: 0005515 protein binding
Probab=98.94 E-value=2.6e-09 Score=70.36 Aligned_cols=49 Identities=27% Similarity=0.409 Sum_probs=40.5
Q ss_pred ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCC
Q 014195 161 AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLP 209 (429)
Q Consensus 161 ~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p 209 (429)
||.+|++++.+++|||+||..........+++++||+++++|+++++|+
T Consensus 1 ~r~~hs~~~~~~kiyv~GG~~~~~~~~~~~~v~~~d~~t~~W~~~~~~g 49 (49)
T PF07646_consen 1 PRYGHSAVVLDGKIYVFGGYGTDNGGSSSNDVWVFDTETNQWTELSPMG 49 (49)
T ss_pred CccceEEEEECCEEEEECCcccCCCCcccceeEEEECCCCEEeecCCCC
Confidence 5889999999999999999922222234889999999999999998875
No 40
>PF13418 Kelch_4: Galactose oxidase, central domain; PDB: 2UVK_B.
Probab=98.88 E-value=2.8e-09 Score=70.34 Aligned_cols=48 Identities=27% Similarity=0.519 Sum_probs=30.5
Q ss_pred ccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCC
Q 014195 161 AHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPV 210 (429)
Q Consensus 161 ~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~ 210 (429)
+|..|+++.+ +++|||+||.+.... .++++|+||+++++|++++++|.
T Consensus 1 pR~~h~~~~~~~~~i~v~GG~~~~~~--~~~d~~~~d~~~~~W~~~~~~P~ 49 (49)
T PF13418_consen 1 PRYGHSAVSIGDNSIYVFGGRDSSGS--PLNDLWIFDIETNTWTRLPSMPS 49 (49)
T ss_dssp --BS-EEEEE-TTEEEEE--EEE-TE--E---EEEEETTTTEEEE--SS--
T ss_pred CcceEEEEEEeCCeEEEECCCCCCCc--ccCCEEEEECCCCEEEECCCCCC
Confidence 4778888887 589999999988652 28999999999999999988873
No 41
>smart00612 Kelch Kelch domain.
Probab=98.82 E-value=7.3e-09 Score=67.65 Aligned_cols=47 Identities=40% Similarity=0.630 Sum_probs=41.0
Q ss_pred EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECC
Q 014195 173 YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRG 222 (429)
Q Consensus 173 ~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~ 222 (429)
+||++||..+.. ..+++++||+.+++|+.+++|+.+|..|+++++++
T Consensus 1 ~iyv~GG~~~~~---~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~~g 47 (47)
T smart00612 1 KIYVVGGFDGGQ---RLKSVEVYDPETNKWTPLPSMPTPRSGHGVAVING 47 (47)
T ss_pred CEEEEeCCCCCc---eeeeEEEECCCCCeEccCCCCCCccccceEEEeCC
Confidence 489999986532 37899999999999999999999999999988764
No 42
>smart00612 Kelch Kelch domain.
Probab=98.72 E-value=2.5e-08 Score=65.08 Aligned_cols=47 Identities=23% Similarity=0.392 Sum_probs=39.5
Q ss_pred EEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCC
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGR 172 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~ 172 (429)
+|||+||.+.. ...+++++||+.+++|+.+++|+. +|..++++.+++
T Consensus 1 ~iyv~GG~~~~-~~~~~v~~yd~~~~~W~~~~~~~~--~r~~~~~~~~~g 47 (47)
T smart00612 1 KIYVVGGFDGG-QRLKSVEVYDPETNKWTPLPSMPT--PRSGHGVAVING 47 (47)
T ss_pred CEEEEeCCCCC-ceeeeEEEECCCCCeEccCCCCCC--ccccceEEEeCC
Confidence 48999998753 346789999999999999999988 788888887764
No 43
>PF13854 Kelch_5: Kelch motif
Probab=98.62 E-value=9.2e-08 Score=60.50 Aligned_cols=41 Identities=22% Similarity=0.508 Sum_probs=36.1
Q ss_pred CCCCccCCcEEEECCEEEEEeccCC-CCceeeeEEEEECCCC
Q 014195 108 APVPRLDGAAIQIKNLLYVFAGYGS-IDYVHSHVDIYNFTDN 148 (429)
Q Consensus 108 ~p~~R~~~~~~~~~~~iyv~GG~~~-~~~~~~~~~~yd~~~~ 148 (429)
+|.+|.+|++++++++|||+||.+. .+...+++|+||+.+.
T Consensus 1 ~P~~R~~hs~~~~~~~iyi~GG~~~~~~~~~~d~~~l~l~sf 42 (42)
T PF13854_consen 1 IPSPRYGHSAVVVGNNIYIFGGYSGNNNSYSNDLYVLDLPSF 42 (42)
T ss_pred CCCCccceEEEEECCEEEEEcCccCCCCCEECcEEEEECCCC
Confidence 4889999999999999999999984 6667899999998763
No 44
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=98.61 E-value=6e-06 Score=73.36 Aligned_cols=153 Identities=16% Similarity=0.246 Sum_probs=94.5
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC----CceEeCC-CCCCCCC
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET----KKWQDLP-PLPVPRY 213 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t----~~W~~~~-~~p~~r~ 213 (429)
.-..||+.+++++.+...... -+...+..-+++++++||... + ...+-.|++.+ ..|.+.+ .|..+|.
T Consensus 47 ~s~~yD~~tn~~rpl~v~td~--FCSgg~~L~dG~ll~tGG~~~-G----~~~ir~~~p~~~~~~~~w~e~~~~m~~~RW 119 (243)
T PF07250_consen 47 HSVEYDPNTNTFRPLTVQTDT--FCSGGAFLPDGRLLQTGGDND-G----NKAIRIFTPCTSDGTCDWTESPNDMQSGRW 119 (243)
T ss_pred EEEEEecCCCcEEeccCCCCC--cccCcCCCCCCCEEEeCCCCc-c----ccceEEEecCCCCCCCCceECcccccCCCc
Confidence 457899999999987543221 122223344789999999754 2 34566787765 6798876 5999999
Q ss_pred CceEEEE-CCEEEEEeCCCCCCCCccccceEeeeecCCccccceeecc----CCCCCCCceeEEEeCCEEEEEcccCCCC
Q 014195 214 APATQLW-RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEI----PIPRGGPHRACVVVDDRLLVIGGQEGDF 288 (429)
Q Consensus 214 ~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~----~~p~~~~~~~~~~~~~~iyv~GG~~~~~ 288 (429)
..++..+ +|+++|+||..... .+.|.-.. -......|..+. ..+...+-+..+.-+|+||+++....
T Consensus 120 YpT~~~L~DG~vlIvGG~~~~t----~E~~P~~~--~~~~~~~~~~l~~~~~~~~~nlYP~~~llPdG~lFi~an~~s-- 191 (243)
T PF07250_consen 120 YPTATTLPDGRVLIVGGSNNPT----YEFWPPKG--PGPGPVTLPFLSQTSDTLPNNLYPFVHLLPDGNLFIFANRGS-- 191 (243)
T ss_pred cccceECCCCCEEEEeCcCCCc----ccccCCcc--CCCCceeeecchhhhccCccccCceEEEcCCCCEEEEEcCCc--
Confidence 9988876 89999999987322 22221000 001111222121 22344444566677999999998631
Q ss_pred CCCCCCCccccccCCeeeeCceEEeCCCCCe-EEcCCCCC
Q 014195 289 MAKPGSPIFKCSRRNEVVYDDVYMLDDEMKW-KVLPSMPK 327 (429)
Q Consensus 289 ~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W-~~~~~~~~ 327 (429)
.++.+ .++++ +.++.+|.
T Consensus 192 --------------------~i~d~-~~n~v~~~lP~lPg 210 (243)
T PF07250_consen 192 --------------------IIYDY-KTNTVVRTLPDLPG 210 (243)
T ss_pred --------------------EEEeC-CCCeEEeeCCCCCC
Confidence 14444 66665 77887764
No 45
>PF07250 Glyoxal_oxid_N: Glyoxal oxidase N-terminus; InterPro: IPR009880 This entry represents the N terminus (approximately 300 residues) of a number of plant and fungal glyoxal oxidase enzymes. Glyoxal oxidase catalyses the oxidation of aldehydes to carboxylic acids, coupled with reduction of dioxygen to hydrogen peroxide. It is an essential component of the extracellular lignin degradation pathways of the wood-rot fungus Phanerochaete chrysosporium [].
Probab=98.58 E-value=6.2e-06 Score=73.26 Aligned_cols=154 Identities=18% Similarity=0.286 Sum_probs=96.7
Q ss_pred ceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeecc-CCCCCCCc
Q 014195 190 AHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEI-PIPRGGPH 268 (429)
Q Consensus 190 ~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~-~~p~~~~~ 268 (429)
.....||+.+++++.+.-..-.-+...+..-+|++.+.||..... ..+..++. +.+..+..|.+.. .|...|..
T Consensus 46 a~s~~yD~~tn~~rpl~v~td~FCSgg~~L~dG~ll~tGG~~~G~--~~ir~~~p---~~~~~~~~w~e~~~~m~~~RWY 120 (243)
T PF07250_consen 46 AHSVEYDPNTNTFRPLTVQTDTFCSGGAFLPDGRLLQTGGDNDGN--KAIRIFTP---CTSDGTCDWTESPNDMQSGRWY 120 (243)
T ss_pred EEEEEEecCCCcEEeccCCCCCcccCcCCCCCCCEEEeCCCCccc--cceEEEec---CCCCCCCCceECcccccCCCcc
Confidence 345679999999998864433334444455689999999986422 22333331 1113356798765 47777777
Q ss_pred eeEEEe-CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEe-CC------CCCeEEcCCC--CCCCCCcceeEEE
Q 014195 269 RACVVV-DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYML-DD------EMKWKVLPSM--PKPDSHIEFAWVL 338 (429)
Q Consensus 269 ~~~~~~-~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~-d~------~~~W~~~~~~--~~~r~~~~~~~~~ 338 (429)
.++..+ ||+++|+||.... .|.| +. ...|..+... ..+....-+..+.
T Consensus 121 pT~~~L~DG~vlIvGG~~~~----------------------t~E~~P~~~~~~~~~~~~~l~~~~~~~~~nlYP~~~ll 178 (243)
T PF07250_consen 121 PTATTLPDGRVLIVGGSNNP----------------------TYEFWPPKGPGPGPVTLPFLSQTSDTLPNNLYPFVHLL 178 (243)
T ss_pred ccceECCCCCEEEEeCcCCC----------------------cccccCCccCCCCceeeecchhhhccCccccCceEEEc
Confidence 777665 8899999998632 1222 11 1122222211 1223333344578
Q ss_pred ECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCe-EEecccCcc
Q 014195 339 VNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKW-HVIGKLPYR 384 (429)
Q Consensus 339 ~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W-~~v~~lp~~ 384 (429)
.+|+||+++.. +-.+||+.++++ +.++.+|..
T Consensus 179 PdG~lFi~an~--------------~s~i~d~~~n~v~~~lP~lPg~ 211 (243)
T PF07250_consen 179 PDGNLFIFANR--------------GSIIYDYKTNTVVRTLPDLPGG 211 (243)
T ss_pred CCCCEEEEEcC--------------CcEEEeCCCCeEEeeCCCCCCC
Confidence 89999999975 457789999987 778888864
No 46
>PLN02772 guanylate kinase
Probab=98.53 E-value=6.5e-07 Score=84.34 Aligned_cols=87 Identities=17% Similarity=0.238 Sum_probs=67.7
Q ss_pred CCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCC-CCCCccceeeEEEe-CCEEEEEeCeeCCCCC
Q 014195 109 PVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDM-PREMAHSHLGMVTD-GRYIYVVTGQYGPQCR 186 (429)
Q Consensus 109 p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~-~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~ 186 (429)
..++..++++.+++++||+||.+......+.+++||..+++|....-+ ..|.+|.+|+++++ +++|+|+++....
T Consensus 22 ~~~~~~~tav~igdk~yv~GG~~d~~~~~~~v~i~D~~t~~W~~P~V~G~~P~~r~GhSa~v~~~~rilv~~~~~~~--- 98 (398)
T PLN02772 22 VKPKNRETSVTIGDKTYVIGGNHEGNTLSIGVQILDKITNNWVSPIVLGTGPKPCKGYSAVVLNKDRILVIKKGSAP--- 98 (398)
T ss_pred CCCCCcceeEEECCEEEEEcccCCCccccceEEEEECCCCcEecccccCCCCCCCCcceEEEECCceEEEEeCCCCC---
Confidence 357889999999999999999887664577899999999999875322 22447888888877 6799999864332
Q ss_pred CCCceeEEEeCCCC
Q 014195 187 GPTAHTFVLDTETK 200 (429)
Q Consensus 187 ~~~~~~~~yd~~t~ 200 (429)
..++|.+...|.
T Consensus 99 --~~~~w~l~~~t~ 110 (398)
T PLN02772 99 --DDSIWFLEVDTP 110 (398)
T ss_pred --ccceEEEEcCCH
Confidence 357888877764
No 47
>PLN02772 guanylate kinase
Probab=98.51 E-value=5.8e-07 Score=84.67 Aligned_cols=81 Identities=16% Similarity=0.205 Sum_probs=64.7
Q ss_pred CCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEe---cccCcceeeeeeEEE-CCEEEEEccc
Q 014195 328 PDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVI---GKLPYRVKTTLAGYW-NGWLYFTSGQ 403 (429)
Q Consensus 328 ~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v---~~lp~~r~~~~~~~~-~~~i~v~GG~ 403 (429)
|+.. .+++.+++++||+||.++... ..+.+++||+.+++|... +..|.+|.+|+++++ +++|+|+++.
T Consensus 24 ~~~~--~tav~igdk~yv~GG~~d~~~------~~~~v~i~D~~t~~W~~P~V~G~~P~~r~GhSa~v~~~~rilv~~~~ 95 (398)
T PLN02772 24 PKNR--ETSVTIGDKTYVIGGNHEGNT------LSIGVQILDKITNNWVSPIVLGTGPKPCKGYSAVVLNKDRILVIKKG 95 (398)
T ss_pred CCCc--ceeEEECCEEEEEcccCCCcc------ccceEEEEECCCCcEecccccCCCCCCCCcceEEEECCceEEEEeCC
Confidence 4444 456899999999999887653 467999999999999774 789999999999988 5899999875
Q ss_pred CCCCCCCCCCccccccEEeeeee
Q 014195 404 RDKGPDDPAPRKVHGDMWRTKLL 426 (429)
Q Consensus 404 ~~~~~~~~~~~~~~~d~w~~~~~ 426 (429)
..+ + .++|.|++-
T Consensus 96 ~~~-------~---~~~w~l~~~ 108 (398)
T PLN02772 96 SAP-------D---DSIWFLEVD 108 (398)
T ss_pred CCC-------c---cceEEEEcC
Confidence 431 1 568988863
No 48
>PF13854 Kelch_5: Kelch motif
Probab=98.39 E-value=6.8e-07 Score=56.49 Aligned_cols=40 Identities=23% Similarity=0.307 Sum_probs=32.9
Q ss_pred CCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 159 EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 159 ~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
|.+|.+|++++++++|||+||... .....++++|+||+.+
T Consensus 2 P~~R~~hs~~~~~~~iyi~GG~~~-~~~~~~~d~~~l~l~s 41 (42)
T PF13854_consen 2 PSPRYGHSAVVVGNNIYIFGGYSG-NNNSYSNDLYVLDLPS 41 (42)
T ss_pred CCCccceEEEEECCEEEEEcCccC-CCCCEECcEEEEECCC
Confidence 447999999999999999999985 2223389999999876
No 49
>TIGR01640 F_box_assoc_1 F-box protein interaction domain. This model describes a large family of plant domains, with several hundred members in Arabidopsis thaliana. Most examples are found C-terminal to an F-box (pfam00646), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes. Some members have two copies of this domain.
Probab=98.37 E-value=0.00014 Score=65.32 Aligned_cols=197 Identities=14% Similarity=0.157 Sum_probs=113.2
Q ss_pred eEEEEECCCCceeeCCCCCCCC---ccceeeEEEe---CC-EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCC
Q 014195 139 HVDIYNFTDNTWGGRFDMPREM---AHSHLGMVTD---GR-YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVP 211 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~---~r~~~~~~~~---~~-~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~ 211 (429)
.+.++||.|++|..+|+.+.+. .+...++... +. +|..+....... ....+++|+..++.|+.+...+..
T Consensus 15 ~~~V~NP~T~~~~~LP~~~~~~~~~~~~~~~~G~d~~~~~YKVv~~~~~~~~~---~~~~~~Vys~~~~~Wr~~~~~~~~ 91 (230)
T TIGR01640 15 RLVVWNPSTGQSRWLPTPKSRRSNKESDTYFLGYDPIEKQYKVLCFSDRSGNR---NQSEHQVYTLGSNSWRTIECSPPH 91 (230)
T ss_pred cEEEECCCCCCEEecCCCCCcccccccceEEEeecccCCcEEEEEEEeecCCC---CCccEEEEEeCCCCccccccCCCC
Confidence 5899999999999997654321 1111122111 11 455554321111 145789999999999998743321
Q ss_pred -CCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCC----CceeEEEeCCEEEEEcccCC
Q 014195 212 -RYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGG----PHRACVVVDDRLLVIGGQEG 286 (429)
Q Consensus 212 -r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~----~~~~~~~~~~~iyv~GG~~~ 286 (429)
......+.++|.||-+.-..... .. ..+..||..+++|+...++|... .....+.++|+|.++.....
T Consensus 92 ~~~~~~~v~~~G~lyw~~~~~~~~-----~~--~~IvsFDl~~E~f~~~i~~P~~~~~~~~~~~L~~~~G~L~~v~~~~~ 164 (230)
T TIGR01640 92 HPLKSRGVCINGVLYYLAYTLKTN-----PD--YFIVSFDVSSERFKEFIPLPCGNSDSVDYLSLINYKGKLAVLKQKKD 164 (230)
T ss_pred ccccCCeEEECCEEEEEEEECCCC-----Cc--EEEEEEEcccceEeeeeecCccccccccceEEEEECCEEEEEEecCC
Confidence 11222677899999886432110 00 12445668899999533344322 13466778899888775421
Q ss_pred CCCCCCCCCccccccCCeeeeCceEEeC--CCCCeEEcCCCC---CCCCC--cceeEEEECCEEEEEcccCCCCCCccce
Q 014195 287 DFMAKPGSPIFKCSRRNEVVYDDVYMLD--DEMKWKVLPSMP---KPDSH--IEFAWVLVNNSIVIVGGTTEKHPTTKKM 359 (429)
Q Consensus 287 ~~~~~~~~~~~~~~~~~~~~~~~v~~~d--~~~~W~~~~~~~---~~r~~--~~~~~~~~~~~i~v~GG~~~~~~~~~~~ 359 (429)
.. .-++|..+ ....|+++-.++ .+... .....+..+++|++.... ...
T Consensus 165 ~~------------------~~~IWvl~d~~~~~W~k~~~i~~~~~~~~~~~~~~~~~~~~g~I~~~~~~-~~~------ 219 (230)
T TIGR01640 165 TN------------------NFDLWVLNDAGKQEWSKLFTVPIPPLPDLVDDNFLSGFTDKGEIVLCCED-ENP------ 219 (230)
T ss_pred CC------------------cEEEEEECCCCCCceeEEEEEcCcchhhhhhheeEeEEeeCCEEEEEeCC-CCc------
Confidence 10 12588875 456799764332 12111 123346778899888753 111
Q ss_pred eeeCcEEEEecCCC
Q 014195 360 VLVGEIFQFNLNTL 373 (429)
Q Consensus 360 ~~~~~i~~yd~~~~ 373 (429)
.-+..||+++|
T Consensus 220 ---~~~~~y~~~~~ 230 (230)
T TIGR01640 220 ---FYIFYYNVGEN 230 (230)
T ss_pred ---eEEEEEeccCC
Confidence 14899999875
No 50
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=98.24 E-value=0.0027 Score=61.99 Aligned_cols=287 Identities=14% Similarity=0.110 Sum_probs=148.7
Q ss_pred HHHhhcceeeeecCCCcccceeeeeeecCCCCe--EEecCCCC----------CCCcceeeeecC-CCCcCccccccccc
Q 014195 28 GFALVADFFWASSSKFTSSYLNIASNWSPYHNS--IILPNNGP----------QKGENIGVKTKK-DVVPKRILPATFQD 94 (429)
Q Consensus 28 ~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~--~~~p~~~~----------r~~~~~~~~~~~-~~~~~~~~~~~~~~ 94 (429)
..++.++.||+... ++ .+.++|..+.+ ....-... +..-+.....+. +..+ ....++.
T Consensus 64 sPvv~~~~vy~~~~-~g-----~l~ald~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~v~~~~v~v~~---~~g~l~a 134 (394)
T PRK11138 64 HPAVAYNKVYAADR-AG-----LVKALDADTGKEIWSVDLSEKDGWFSKNKSALLSGGVTVAGGKVYIGS---EKGQVYA 134 (394)
T ss_pred ccEEECCEEEEECC-CC-----eEEEEECCCCcEeeEEcCCCcccccccccccccccccEEECCEEEEEc---CCCEEEE
Confidence 34678999999654 22 68899998888 33222110 001111111111 1111 2345777
Q ss_pred ccccCC--CeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCccceeeEEEe
Q 014195 95 LPAPEL--KWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSHLGMVTD 170 (429)
Q Consensus 95 ~d~~~~--~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~~~~~~~ 170 (429)
+|..+. .|+.-.. .+ ...+-++.++.+|+..+ ...++.+|+++.+ |+.-...+....+...+-++.
T Consensus 135 ld~~tG~~~W~~~~~--~~-~~ssP~v~~~~v~v~~~-------~g~l~ald~~tG~~~W~~~~~~~~~~~~~~~sP~v~ 204 (394)
T PRK11138 135 LNAEDGEVAWQTKVA--GE-ALSRPVVSDGLVLVHTS-------NGMLQALNESDGAVKWTVNLDVPSLTLRGESAPATA 204 (394)
T ss_pred EECCCCCCcccccCC--Cc-eecCCEEECCEEEEECC-------CCEEEEEEccCCCEeeeecCCCCcccccCCCCCEEE
Confidence 887664 6865322 11 11233455788887543 1348999998876 876433222111222334455
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCc--eEeCCCCCCC--------CCCceEEEECCEEEEEeCCCCCCCCcccc
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKK--WQDLPPLPVP--------RYAPATQLWRGRLHVMGGSGENRYTPEVD 240 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~--W~~~~~~p~~--------r~~~~~~~~~~~lyv~GG~~~~~~~~~~~ 240 (429)
++.+|+..+ ...+..+|+++.+ |+.-...|.. ....+-++.++.+|+.+.. + ...
T Consensus 205 ~~~v~~~~~---------~g~v~a~d~~~G~~~W~~~~~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~~-g-----~l~ 269 (394)
T PRK11138 205 FGGAIVGGD---------NGRVSAVLMEQGQLIWQQRISQPTGATEIDRLVDVDTTPVVVGGVVYALAYN-G-----NLV 269 (394)
T ss_pred CCEEEEEcC---------CCEEEEEEccCChhhheeccccCCCccchhcccccCCCcEEECCEEEEEEcC-C-----eEE
Confidence 777776433 3467788888764 8753221211 1123345678899986531 1 111
Q ss_pred ceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CC--C
Q 014195 241 HWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DE--M 317 (429)
Q Consensus 241 ~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~--~ 317 (429)
.++. ...+..|+.....+ ...++.+++||+..... .++.+| .+ .
T Consensus 270 ald~-----~tG~~~W~~~~~~~-----~~~~~~~~~vy~~~~~g-----------------------~l~ald~~tG~~ 316 (394)
T PRK11138 270 ALDL-----RSGQIVWKREYGSV-----NDFAVDGGRIYLVDQND-----------------------RVYALDTRGGVE 316 (394)
T ss_pred EEEC-----CCCCEEEeecCCCc-----cCcEEECCEEEEEcCCC-----------------------eEEEEECCCCcE
Confidence 2221 12234587632211 13456789999876421 377777 43 4
Q ss_pred CeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC--eEEecccCcceeeeeeEEECC
Q 014195 318 KWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK--WHVIGKLPYRVKTTLAGYWNG 395 (429)
Q Consensus 318 ~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~--W~~v~~lp~~r~~~~~~~~~~ 395 (429)
.|+.-. + ..+.. .+.++.+++||+.... ..++.+|+++.+ |+. .++......+-+..++
T Consensus 317 ~W~~~~-~-~~~~~--~sp~v~~g~l~v~~~~-------------G~l~~ld~~tG~~~~~~--~~~~~~~~s~P~~~~~ 377 (394)
T PRK11138 317 LWSQSD-L-LHRLL--TAPVLYNGYLVVGDSE-------------GYLHWINREDGRFVAQQ--KVDSSGFLSEPVVADD 377 (394)
T ss_pred EEcccc-c-CCCcc--cCCEEECCEEEEEeCC-------------CEEEEEECCCCCEEEEE--EcCCCcceeCCEEECC
Confidence 576422 1 11221 2235678998875321 268888988764 433 2222223334456788
Q ss_pred EEEEE
Q 014195 396 WLYFT 400 (429)
Q Consensus 396 ~i~v~ 400 (429)
+||+.
T Consensus 378 ~l~v~ 382 (394)
T PRK11138 378 KLLIQ 382 (394)
T ss_pred EEEEE
Confidence 88776
No 51
>TIGR01640 F_box_assoc_1 F-box protein interaction domain. This model describes a large family of plant domains, with several hundred members in Arabidopsis thaliana. Most examples are found C-terminal to an F-box (pfam00646), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes. Some members have two copies of this domain.
Probab=98.23 E-value=0.00028 Score=63.32 Aligned_cols=182 Identities=13% Similarity=0.210 Sum_probs=107.7
Q ss_pred cccccccccCCCeEEccCCCCCcc--CC--cEEEE----CC-EEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCC
Q 014195 90 ATFQDLPAPELKWEKMKAAPVPRL--DG--AAIQI----KN-LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREM 160 (429)
Q Consensus 90 ~~~~~~d~~~~~W~~~~~~p~~R~--~~--~~~~~----~~-~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~ 160 (429)
..+...||.+.+|..++..+.++. .. ....+ ++ +|..+....... ....+++|+..+++|+.+...+...
T Consensus 14 ~~~~V~NP~T~~~~~LP~~~~~~~~~~~~~~~~G~d~~~~~YKVv~~~~~~~~~-~~~~~~Vys~~~~~Wr~~~~~~~~~ 92 (230)
T TIGR01640 14 KRLVVWNPSTGQSRWLPTPKSRRSNKESDTYFLGYDPIEKQYKVLCFSDRSGNR-NQSEHQVYTLGSNSWRTIECSPPHH 92 (230)
T ss_pred CcEEEECCCCCCEEecCCCCCcccccccceEEEeecccCCcEEEEEEEeecCCC-CCccEEEEEeCCCCccccccCCCCc
Confidence 457789999999999986554211 11 11112 22 455554331111 1245899999999999986433211
Q ss_pred ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEe-CCCCCCCC----CCceEEEECCEEEEEeCCCCCCC
Q 014195 161 AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQD-LPPLPVPR----YAPATQLWRGRLHVMGGSGENRY 235 (429)
Q Consensus 161 ~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~-~~~~p~~r----~~~~~~~~~~~lyv~GG~~~~~~ 235 (429)
..... .+.++|.||-+.-..... ....+..||..+.+|.. ++ +|..+ ....++.++|+|.++......
T Consensus 93 ~~~~~-~v~~~G~lyw~~~~~~~~---~~~~IvsFDl~~E~f~~~i~-~P~~~~~~~~~~~L~~~~G~L~~v~~~~~~-- 165 (230)
T TIGR01640 93 PLKSR-GVCINGVLYYLAYTLKTN---PDYFIVSFDVSSERFKEFIP-LPCGNSDSVDYLSLINYKGKLAVLKQKKDT-- 165 (230)
T ss_pred cccCC-eEEECCEEEEEEEECCCC---CcEEEEEEEcccceEeeeee-cCccccccccceEEEEECCEEEEEEecCCC--
Confidence 11122 567788899886432211 12378999999999995 43 34332 234677889999988764321
Q ss_pred CccccceEeeeecCCccccceeeccCCC-----CCC--CceeEEEeCCEEEEEccc
Q 014195 236 TPEVDHWSLAVKDGKPLEKEWRTEIPIP-----RGG--PHRACVVVDDRLLVIGGQ 284 (429)
Q Consensus 236 ~~~~~~~~~~~~~~d~~~~~W~~~~~~p-----~~~--~~~~~~~~~~~iyv~GG~ 284 (429)
...+.|.+. |.....|++.-.++ ... .....+..+++|++.-..
T Consensus 166 -~~~~IWvl~----d~~~~~W~k~~~i~~~~~~~~~~~~~~~~~~~~g~I~~~~~~ 216 (230)
T TIGR01640 166 -NNFDLWVLN----DAGKQEWSKLFTVPIPPLPDLVDDNFLSGFTDKGEIVLCCED 216 (230)
T ss_pred -CcEEEEEEC----CCCCCceeEEEEEcCcchhhhhhheeEeEEeeCCEEEEEeCC
Confidence 347889864 23345698742222 111 123456678888886653
No 52
>PF03089 RAG2: Recombination activating protein 2; InterPro: IPR004321 The variable portion of the genes encoding immunoglobulins and T cell receptors are assembled from component V, D, and J DNA segments by a site-specific recombination reaction termed V(D)J recombination. V(D)J recombination is targeted to specific sites on the chromosome by recombination signal sequences (RSSs) that flank antigen receptor gene segments. The RSS consists of a conserved heptamer (consensus, 5'-CACAGTG-3') and nonamer (consensus, 5'-ACAAAAACC-3') separated by a spacer of either 12 or 23 bp. Efficient recombination occurs between a 12-RSS and a 23-RSS, a restriction known as the 12/23 rule. V(D)J recombination can be divided into two phases, DNA cleavage and DNA joining. DNA cleavage requires two lymphocyte-specific factors, the products of the recombination activating genes, RAG1 and RAG2, which together recognise the RSSs and create double strand breaks at the RSS-coding segment junctions []. RAG-mediated DNA cleavage occurs in a synaptic complex termed the paired complex, which is constituted from two distinct RSS-RAG complexes, a 12-SC and a 23-SC (where SC stands for signal complex). The DNA cleavage reaction involves two distinct enzymatic steps, initial nicking that creates a 3'-OH between a coding segment and its RSS, followed by hairpin formation in which the newly created 3'-OH attacks a phosphodiester bond on the opposite DNA strand. This generates a blunt, 5' phosphorylated signal end containing all of the RSS elements, and a covalently sealed hairpin coding end. The second phase of V(D)J recombination, in which broken DNA fragments are processed and joined, is less well characterised. Signal ends are typically joined precisely to form a signal joint, whereas joining of the coding ends requires the hairpin structure to be opened and typically involves nucleotide addition and deletion before formation of the coding joint. The factors involved in these processes include ubiquitously expressed proteins involved in the repair of DNA double strand breaks by nonhomologous end joining, terminal deoxynucleotidyl transferase, and Artemis protein. In addition to their critical roles in RSS recognition and DNA cleavage, the RAG proteins may perform two distinct types of functions in the postcleavage phase of V(D)J. A structural function has been inferred from the finding that, after DNA cleavage in vitro, the DNA ends remain associated with the RAG proteins in a "four end" complex known as the cleaved signal complex. After release of the coding ends in vitro, and after coding joint formation in vivo, the RAG proteins remain in a stable signal end complex (SEC) containing the two signal ends. These postcleavage complexes may serve as essential scaffolds for the second phase of the reaction, with the RAG proteins acting to organise the DNA processing and joining events. The second type of RAG protein-mediated postcleavage activity is the catalysis of phosphodiester bond hydrolysis and strand transfer reactions. The RAG proteins are capable of opening hairpin coding ends in vitro. The RAG proteins also show 3' flap endonuclease activity that may contribute to coding end processing/joining and can utilise the 3' OH group on the signal ends to attack hairpin coding ends (forming hybrid or open/shut joints) or virtually any DNA duplex (forming a transposition product).; GO: 0003677 DNA binding, 0006310 DNA recombination, 0005634 nucleus
Probab=98.03 E-value=0.0021 Score=57.15 Aligned_cols=120 Identities=13% Similarity=0.085 Sum_probs=78.9
Q ss_pred EEEEEeccCCCCceeeeEEEEECCCCce-----------eeCCCCCCCCccceeeEEEe----CCEEEEEeCeeC-----
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTDNTW-----------GGRFDMPREMAHSHLGMVTD----GRYIYVVTGQYG----- 182 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~~~W-----------~~~~~~~~~~~r~~~~~~~~----~~~lyv~GG~~~----- 182 (429)
.-+|-||....+...+++++........ +.+.++|. +|++|++.++ ..-+.+|||+.-
T Consensus 40 ~YlIHGGrTPNNElS~~LY~ls~~s~~cNkK~tl~C~EKeLvGdvP~--aRYGHt~~vV~SrGKta~VlFGGRSY~P~~q 117 (337)
T PF03089_consen 40 QYLIHGGRTPNNELSSSLYILSVDSRGCNKKVTLCCQEKELVGDVPE--ARYGHTINVVHSRGKTACVLFGGRSYMPPGQ 117 (337)
T ss_pred eEEecCCcCCCcccccceEEEEeecCCCCceeEEEEecceecCCCCc--ccccceEEEEEECCcEEEEEECCcccCCccc
Confidence 3566788887777777788776654431 12466776 8999998776 235777899621
Q ss_pred ------CCCCCCCceeEEEeCCCCceE--eCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 183 ------PQCRGPTAHTFVLDTETKKWQ--DLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 183 ------~~~~~~~~~~~~yd~~t~~W~--~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
+.-.+....|+..|++-.-.+ .++.+....++|.+.+-++.+|++||..-.....-...|.+
T Consensus 118 RTTenWNsVvDC~P~VfLiDleFGC~tah~lpEl~dG~SFHvslar~D~VYilGGHsl~sd~Rpp~l~rl 187 (337)
T PF03089_consen 118 RTTENWNSVVDCPPQVFLIDLEFGCCTAHTLPELQDGQSFHVSLARNDCVYILGGHSLESDSRPPRLYRL 187 (337)
T ss_pred cchhhcceeccCCCeEEEEeccccccccccchhhcCCeEEEEEEecCceEEEEccEEccCCCCCCcEEEE
Confidence 011122456777788766544 35677788899999999999999999764433233344443
No 53
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=98.02 E-value=0.013 Score=56.64 Aligned_cols=289 Identities=15% Similarity=0.110 Sum_probs=143.3
Q ss_pred HHHHhhcceeeeecCCCcccceeeeeeecCCCCe--EEecCCCCCCCcceeeeecC-CCCcCcccccccccccccCC--C
Q 014195 27 LGFALVADFFWASSSKFTSSYLNIASNWSPYHNS--IILPNNGPQKGENIGVKTKK-DVVPKRILPATFQDLPAPEL--K 101 (429)
Q Consensus 27 ~~~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~--~~~p~~~~r~~~~~~~~~~~-~~~~~~~~~~~~~~~d~~~~--~ 101 (429)
.+.++.++.+|+.+ .++ .+.++|+.+.+ ....-.. +..-+.....+. +..+ ....++.+|..++ .
T Consensus 59 ~~p~v~~~~v~v~~-~~g-----~v~a~d~~tG~~~W~~~~~~-~~~~~p~v~~~~v~v~~---~~g~l~ald~~tG~~~ 128 (377)
T TIGR03300 59 LQPAVAGGKVYAAD-ADG-----TVVALDAETGKRLWRVDLDE-RLSGGVGADGGLVFVGT---EKGEVIALDAEDGKEL 128 (377)
T ss_pred cceEEECCEEEEEC-CCC-----eEEEEEccCCcEeeeecCCC-CcccceEEcCCEEEEEc---CCCEEEEEECCCCcEe
Confidence 34467788888854 233 68899998888 2222111 110011111111 1111 2345777887654 5
Q ss_pred eEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCccceeeEEEeCCEEEEEeC
Q 014195 102 WEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSHLGMVTDGRYIYVVTG 179 (429)
Q Consensus 102 W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG 179 (429)
|+.-.. .. ...+.+..++.+|+..+ ...++++|+++.+ |+.-...+....+...+.++.++.+|+ |.
T Consensus 129 W~~~~~--~~-~~~~p~v~~~~v~v~~~-------~g~l~a~d~~tG~~~W~~~~~~~~~~~~~~~sp~~~~~~v~~-~~ 197 (377)
T TIGR03300 129 WRAKLS--SE-VLSPPLVANGLVVVRTN-------DGRLTALDAATGERLWTYSRVTPALTLRGSASPVIADGGVLV-GF 197 (377)
T ss_pred eeeccC--ce-eecCCEEECCEEEEECC-------CCeEEEEEcCCCceeeEEccCCCceeecCCCCCEEECCEEEE-EC
Confidence 865321 11 11233445778777532 1348899998764 775332221001222344555676554 32
Q ss_pred eeCCCCCCCCceeEEEeCCCC--ceEeCCCCCCCC--------CCceEEEECCEEEEEeCCCCCCCCccccceEeeeecC
Q 014195 180 QYGPQCRGPTAHTFVLDTETK--KWQDLPPLPVPR--------YAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDG 249 (429)
Q Consensus 180 ~~~~~~~~~~~~~~~yd~~t~--~W~~~~~~p~~r--------~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~ 249 (429)
. ...+..+|+.+. .|+.-...+... ...+.+..++.+|+..... ....++.
T Consensus 198 ~--------~g~v~ald~~tG~~~W~~~~~~~~g~~~~~~~~~~~~~p~~~~~~vy~~~~~g------~l~a~d~----- 258 (377)
T TIGR03300 198 A--------GGKLVALDLQTGQPLWEQRVALPKGRTELERLVDVDGDPVVDGGQVYAVSYQG------RVAALDL----- 258 (377)
T ss_pred C--------CCEEEEEEccCCCEeeeeccccCCCCCchhhhhccCCccEEECCEEEEEEcCC------EEEEEEC-----
Confidence 1 246888998876 486532222111 1233445678888864321 1222221
Q ss_pred CccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CC--CCeEEcCCCC
Q 014195 250 KPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DE--MKWKVLPSMP 326 (429)
Q Consensus 250 d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~--~~W~~~~~~~ 326 (429)
...+..|+.... . ....++.+++||+.... + .++.+| .+ ..|+.-. +.
T Consensus 259 ~tG~~~W~~~~~---~--~~~p~~~~~~vyv~~~~-G----------------------~l~~~d~~tG~~~W~~~~-~~ 309 (377)
T TIGR03300 259 RSGRVLWKRDAS---S--YQGPAVDDNRLYVTDAD-G----------------------VVVALDRRSGSELWKNDE-LK 309 (377)
T ss_pred CCCcEEEeeccC---C--ccCceEeCCEEEEECCC-C----------------------eEEEEECCCCcEEEcccc-cc
Confidence 123445766421 1 12445678899987532 1 377777 43 4576522 11
Q ss_pred CCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC--eEEecccCcceeeeeeEEECCEEEEEcc
Q 014195 327 KPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK--WHVIGKLPYRVKTTLAGYWNGWLYFTSG 402 (429)
Q Consensus 327 ~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~--W~~v~~lp~~r~~~~~~~~~~~i~v~GG 402 (429)
. +.. .+.++.++.||+.. .+ ..++.+|+++.+ |+. +++......+.+..+++||+.+.
T Consensus 310 ~-~~~--ssp~i~g~~l~~~~-~~------------G~l~~~d~~tG~~~~~~--~~~~~~~~~sp~~~~~~l~v~~~ 369 (377)
T TIGR03300 310 Y-RQL--TAPAVVGGYLVVGD-FE------------GYLHWLSREDGSFVARL--KTDGSGIASPPVVVGDGLLVQTR 369 (377)
T ss_pred C-Ccc--ccCEEECCEEEEEe-CC------------CEEEEEECCCCCEEEEE--EcCCCccccCCEEECCEEEEEeC
Confidence 1 111 12255677777653 21 268888887653 321 12222233444667888776543
No 54
>PF03089 RAG2: Recombination activating protein 2; InterPro: IPR004321 The variable portion of the genes encoding immunoglobulins and T cell receptors are assembled from component V, D, and J DNA segments by a site-specific recombination reaction termed V(D)J recombination. V(D)J recombination is targeted to specific sites on the chromosome by recombination signal sequences (RSSs) that flank antigen receptor gene segments. The RSS consists of a conserved heptamer (consensus, 5'-CACAGTG-3') and nonamer (consensus, 5'-ACAAAAACC-3') separated by a spacer of either 12 or 23 bp. Efficient recombination occurs between a 12-RSS and a 23-RSS, a restriction known as the 12/23 rule. V(D)J recombination can be divided into two phases, DNA cleavage and DNA joining. DNA cleavage requires two lymphocyte-specific factors, the products of the recombination activating genes, RAG1 and RAG2, which together recognise the RSSs and create double strand breaks at the RSS-coding segment junctions []. RAG-mediated DNA cleavage occurs in a synaptic complex termed the paired complex, which is constituted from two distinct RSS-RAG complexes, a 12-SC and a 23-SC (where SC stands for signal complex). The DNA cleavage reaction involves two distinct enzymatic steps, initial nicking that creates a 3'-OH between a coding segment and its RSS, followed by hairpin formation in which the newly created 3'-OH attacks a phosphodiester bond on the opposite DNA strand. This generates a blunt, 5' phosphorylated signal end containing all of the RSS elements, and a covalently sealed hairpin coding end. The second phase of V(D)J recombination, in which broken DNA fragments are processed and joined, is less well characterised. Signal ends are typically joined precisely to form a signal joint, whereas joining of the coding ends requires the hairpin structure to be opened and typically involves nucleotide addition and deletion before formation of the coding joint. The factors involved in these processes include ubiquitously expressed proteins involved in the repair of DNA double strand breaks by nonhomologous end joining, terminal deoxynucleotidyl transferase, and Artemis protein. In addition to their critical roles in RSS recognition and DNA cleavage, the RAG proteins may perform two distinct types of functions in the postcleavage phase of V(D)J. A structural function has been inferred from the finding that, after DNA cleavage in vitro, the DNA ends remain associated with the RAG proteins in a "four end" complex known as the cleaved signal complex. After release of the coding ends in vitro, and after coding joint formation in vivo, the RAG proteins remain in a stable signal end complex (SEC) containing the two signal ends. These postcleavage complexes may serve as essential scaffolds for the second phase of the reaction, with the RAG proteins acting to organise the DNA processing and joining events. The second type of RAG protein-mediated postcleavage activity is the catalysis of phosphodiester bond hydrolysis and strand transfer reactions. The RAG proteins are capable of opening hairpin coding ends in vitro. The RAG proteins also show 3' flap endonuclease activity that may contribute to coding end processing/joining and can utilise the 3' OH group on the signal ends to attack hairpin coding ends (forming hybrid or open/shut joints) or virtually any DNA duplex (forming a transposition product).; GO: 0003677 DNA binding, 0006310 DNA recombination, 0005634 nucleus
Probab=97.97 E-value=0.00055 Score=60.66 Aligned_cols=111 Identities=13% Similarity=0.223 Sum_probs=66.1
Q ss_pred EEEEE-eCeeCCCCCCCCceeEEEeCCCCc----e-------EeCCCCCCCCCCceEEEE----CCEEEEEeCCCCCC-C
Q 014195 173 YIYVV-TGQYGPQCRGPTAHTFVLDTETKK----W-------QDLPPLPVPRYAPATQLW----RGRLHVMGGSGENR-Y 235 (429)
Q Consensus 173 ~lyv~-GG~~~~~~~~~~~~~~~yd~~t~~----W-------~~~~~~p~~r~~~~~~~~----~~~lyv~GG~~~~~-~ 235 (429)
..|++ ||+..+... .+.+|........ - +.+.++|.+|++|++-++ +....+|||+.-.. -
T Consensus 39 ~~YlIHGGrTPNNEl--S~~LY~ls~~s~~cNkK~tl~C~EKeLvGdvP~aRYGHt~~vV~SrGKta~VlFGGRSY~P~~ 116 (337)
T PF03089_consen 39 EQYLIHGGRTPNNEL--SSSLYILSVDSRGCNKKVTLCCQEKELVGDVPEARYGHTINVVHSRGKTACVLFGGRSYMPPG 116 (337)
T ss_pred eeEEecCCcCCCccc--ccceEEEEeecCCCCceeEEEEecceecCCCCcccccceEEEEEECCcEEEEEECCcccCCcc
Confidence 44554 777655543 5567766555432 1 123479999999999776 23488999975311 1
Q ss_pred CccccceEeeeec------CCccccceee--ccCCCCCCCceeEEEeCCEEEEEcccC
Q 014195 236 TPEVDHWSLAVKD------GKPLEKEWRT--EIPIPRGGPHRACVVVDDRLLVIGGQE 285 (429)
Q Consensus 236 ~~~~~~~~~~~~~------~d~~~~~W~~--~~~~p~~~~~~~~~~~~~~iyv~GG~~ 285 (429)
...++.|+-.+-| .|.+-...+. ++.+..+...|.+..-+|.+|++||+.
T Consensus 117 qRTTenWNsVvDC~P~VfLiDleFGC~tah~lpEl~dG~SFHvslar~D~VYilGGHs 174 (337)
T PF03089_consen 117 QRTTENWNSVVDCPPQVFLIDLEFGCCTAHTLPELQDGQSFHVSLARNDCVYILGGHS 174 (337)
T ss_pred ccchhhcceeccCCCeEEEEeccccccccccchhhcCCeEEEEEEecCceEEEEccEE
Confidence 1234555532111 1222222222 455566777778888899999999985
No 55
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=97.80 E-value=0.026 Score=55.07 Aligned_cols=233 Identities=18% Similarity=0.245 Sum_probs=123.4
Q ss_pred ccccccccCC--CeEEccCCC--------CCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCC
Q 014195 91 TFQDLPAPEL--KWEKMKAAP--------VPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPR 158 (429)
Q Consensus 91 ~~~~~d~~~~--~W~~~~~~p--------~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~ 158 (429)
.+..+|..++ .|+.-..-. .++...+.++.++.||+.+. + ..++++|.++.+ |+.-. +.
T Consensus 80 ~l~ald~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~v~~~~v~v~~~-~------g~l~ald~~tG~~~W~~~~--~~ 150 (394)
T PRK11138 80 LVKALDADTGKEIWSVDLSEKDGWFSKNKSALLSGGVTVAGGKVYIGSE-K------GQVYALNAEDGEVAWQTKV--AG 150 (394)
T ss_pred eEEEEECCCCcEeeEEcCCCcccccccccccccccccEEECCEEEEEcC-C------CEEEEEECCCCCCcccccC--CC
Confidence 5667777654 587532110 11223345666888887432 1 248999998764 86532 22
Q ss_pred CCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc--eEeCCCCCC--CCCCceEEEECCEEEEEeCCCCCC
Q 014195 159 EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK--WQDLPPLPV--PRYAPATQLWRGRLHVMGGSGENR 234 (429)
Q Consensus 159 ~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~--W~~~~~~p~--~r~~~~~~~~~~~lyv~GG~~~~~ 234 (429)
+ ...+.++.++.+|+..+ ...++.+|+++.+ |+.-...|. .+...+-++.++.+|+..+. +.
T Consensus 151 ~---~~ssP~v~~~~v~v~~~---------~g~l~ald~~tG~~~W~~~~~~~~~~~~~~~sP~v~~~~v~~~~~~-g~- 216 (394)
T PRK11138 151 E---ALSRPVVSDGLVLVHTS---------NGMLQALNESDGAVKWTVNLDVPSLTLRGESAPATAFGGAIVGGDN-GR- 216 (394)
T ss_pred c---eecCCEEECCEEEEECC---------CCEEEEEEccCCCEeeeecCCCCcccccCCCCCEEECCEEEEEcCC-CE-
Confidence 1 12233556888887532 3468999998875 887543331 12223334556777664432 11
Q ss_pred CCccccceEeeeecCCccccceeeccCCCCC--------CCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeee
Q 014195 235 YTPEVDHWSLAVKDGKPLEKEWRTEIPIPRG--------GPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVV 306 (429)
Q Consensus 235 ~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~--------~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~ 306 (429)
...++. ......|+.....|.. ....+-++.++.||+.+.. +
T Consensus 217 ----v~a~d~-----~~G~~~W~~~~~~~~~~~~~~~~~~~~~sP~v~~~~vy~~~~~-g-------------------- 266 (394)
T PRK11138 217 ----VSAVLM-----EQGQLIWQQRISQPTGATEIDRLVDVDTTPVVVGGVVYALAYN-G-------------------- 266 (394)
T ss_pred ----EEEEEc-----cCChhhheeccccCCCccchhcccccCCCcEEECCEEEEEEcC-C--------------------
Confidence 111111 1223456643222211 0112345678888886532 1
Q ss_pred eCceEEeC-CC--CCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC--CeEEeccc
Q 014195 307 YDDVYMLD-DE--MKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL--KWHVIGKL 381 (429)
Q Consensus 307 ~~~v~~~d-~~--~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~--~W~~v~~l 381 (429)
.++.+| .+ ..|+.- ...+. ..+..+++||+.... ..++.+|+++. .|+.-. +
T Consensus 267 --~l~ald~~tG~~~W~~~--~~~~~-----~~~~~~~~vy~~~~~-------------g~l~ald~~tG~~~W~~~~-~ 323 (394)
T PRK11138 267 --NLVALDLRSGQIVWKRE--YGSVN-----DFAVDGGRIYLVDQN-------------DRVYALDTRGGVELWSQSD-L 323 (394)
T ss_pred --eEEEEECCCCCEEEeec--CCCcc-----CcEEECCEEEEEcCC-------------CeEEEEECCCCcEEEcccc-c
Confidence 377777 43 458763 11111 236678999987632 26899998875 475321 1
Q ss_pred CcceeeeeeEEECCEEEEE
Q 014195 382 PYRVKTTLAGYWNGWLYFT 400 (429)
Q Consensus 382 p~~r~~~~~~~~~~~i~v~ 400 (429)
..+...+.++.++.||+.
T Consensus 324 -~~~~~~sp~v~~g~l~v~ 341 (394)
T PRK11138 324 -LHRLLTAPVLYNGYLVVG 341 (394)
T ss_pred -CCCcccCCEEECCEEEEE
Confidence 122233344567887765
No 56
>PF07893 DUF1668: Protein of unknown function (DUF1668); InterPro: IPR012871 The hypothetical proteins found in this family are expressed by Oryza sativa (Rice) and are of unknown function.
Probab=97.33 E-value=0.025 Score=53.81 Aligned_cols=129 Identities=22% Similarity=0.271 Sum_probs=81.4
Q ss_pred eCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccc--cceEeeee
Q 014195 170 DGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEV--DHWSLAVK 247 (429)
Q Consensus 170 ~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~--~~~~~~~~ 247 (429)
.+++|+.++.. ....+||+++..-...+.|+.+.....++.++++||++............ ..|....+
T Consensus 75 ~gskIv~~d~~---------~~t~vyDt~t~av~~~P~l~~pk~~pisv~VG~~LY~m~~~~~~~~~~~~~~~~FE~l~~ 145 (342)
T PF07893_consen 75 HGSKIVAVDQS---------GRTLVYDTDTRAVATGPRLHSPKRCPISVSVGDKLYAMDRSPFPEPAGRPDFPCFEALVY 145 (342)
T ss_pred cCCeEEEEcCC---------CCeEEEECCCCeEeccCCCCCCCcceEEEEeCCeEEEeeccCccccccCccceeEEEecc
Confidence 58899988542 34779999999999888888888778888899999999876432211100 02222211
Q ss_pred c------CCccccceeeccCCCCCCC-------ceeEEEe-CCEEEE-EcccCCCCCCCCCCCccccccCCeeeeCceEE
Q 014195 248 D------GKPLEKEWRTEIPIPRGGP-------HRACVVV-DDRLLV-IGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYM 312 (429)
Q Consensus 248 ~------~d~~~~~W~~~~~~p~~~~-------~~~~~~~-~~~iyv-~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~ 312 (429)
. .....-.|+.+++.|-... -.+.+++ +..|+| .-+... -.|.
T Consensus 146 ~~~~~~~~~~~~w~W~~LP~PPf~~~~~~~~~~i~sYavv~g~~I~vS~~~~~~----------------------GTys 203 (342)
T PF07893_consen 146 RPPPDDPSPEESWSWRSLPPPPFVRDRRYSDYRITSYAVVDGRTIFVSVNGRRW----------------------GTYS 203 (342)
T ss_pred ccccccccCCCcceEEcCCCCCccccCCcccceEEEEEEecCCeEEEEecCCce----------------------EEEE
Confidence 1 1133456888766542221 1234555 666888 444310 1699
Q ss_pred eC-CCCCeEEcCCCCCCC
Q 014195 313 LD-DEMKWKVLPSMPKPD 329 (429)
Q Consensus 313 ~d-~~~~W~~~~~~~~~r 329 (429)
|| .+.+|+++..-..|-
T Consensus 204 fDt~~~~W~~~GdW~LPF 221 (342)
T PF07893_consen 204 FDTESHEWRKHGDWMLPF 221 (342)
T ss_pred EEcCCcceeeccceecCc
Confidence 99 899999998644343
No 57
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=97.05 E-value=0.34 Score=46.87 Aligned_cols=210 Identities=19% Similarity=0.264 Sum_probs=108.6
Q ss_pred cccccccccCC--CeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCcccee
Q 014195 90 ATFQDLPAPEL--KWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSHL 165 (429)
Q Consensus 90 ~~~~~~d~~~~--~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~~ 165 (429)
..++.+|..++ .|+.-..- +...+.+..++.+|+.+ .+ ..++++|+.+.+ |+.-. +. ....
T Consensus 75 g~v~a~d~~tG~~~W~~~~~~---~~~~~p~v~~~~v~v~~-~~------g~l~ald~~tG~~~W~~~~--~~---~~~~ 139 (377)
T TIGR03300 75 GTVVALDAETGKRLWRVDLDE---RLSGGVGADGGLVFVGT-EK------GEVIALDAEDGKELWRAKL--SS---EVLS 139 (377)
T ss_pred CeEEEEEccCCcEeeeecCCC---CcccceEEcCCEEEEEc-CC------CEEEEEECCCCcEeeeecc--Cc---eeec
Confidence 45778887655 48643221 11223444567777643 22 258999987764 86532 22 1123
Q ss_pred eEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc--eEeCCCCCC--CCCCceEEEECCEEEEEeCCCCCCCCccccc
Q 014195 166 GMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK--WQDLPPLPV--PRYAPATQLWRGRLHVMGGSGENRYTPEVDH 241 (429)
Q Consensus 166 ~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~--W~~~~~~p~--~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~ 241 (429)
+.++.++.+|+..+ ...++++|+++.+ |+.-...+. .+...+.+..++.+| +|..++ .+..
T Consensus 140 ~p~v~~~~v~v~~~---------~g~l~a~d~~tG~~~W~~~~~~~~~~~~~~~sp~~~~~~v~-~~~~~g-----~v~a 204 (377)
T TIGR03300 140 PPLVANGLVVVRTN---------DGRLTALDAATGERLWTYSRVTPALTLRGSASPVIADGGVL-VGFAGG-----KLVA 204 (377)
T ss_pred CCEEECCEEEEECC---------CCeEEEEEcCCCceeeEEccCCCceeecCCCCCEEECCEEE-EECCCC-----EEEE
Confidence 33456788877532 3468899998754 876433221 122334455666554 443221 1112
Q ss_pred eEeeeecCCccccceeeccCCCCCC--------CceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEe
Q 014195 242 WSLAVKDGKPLEKEWRTEIPIPRGG--------PHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYML 313 (429)
Q Consensus 242 ~~~~~~~~d~~~~~W~~~~~~p~~~--------~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 313 (429)
++.. .....|+.....+... ...+.++.++.||+.... + .++.+
T Consensus 205 ld~~-----tG~~~W~~~~~~~~g~~~~~~~~~~~~~p~~~~~~vy~~~~~-g----------------------~l~a~ 256 (377)
T TIGR03300 205 LDLQ-----TGQPLWEQRVALPKGRTELERLVDVDGDPVVDGGQVYAVSYQ-G----------------------RVAAL 256 (377)
T ss_pred EEcc-----CCCEeeeeccccCCCCCchhhhhccCCccEEECCEEEEEEcC-C----------------------EEEEE
Confidence 2210 2234576532222111 112334567888885532 1 27777
Q ss_pred C-C--CCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC--CeEE
Q 014195 314 D-D--EMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL--KWHV 377 (429)
Q Consensus 314 d-~--~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~--~W~~ 377 (429)
| . +..|+.-. . .. .+.++.+++||+... . ..++.+|..+. .|+.
T Consensus 257 d~~tG~~~W~~~~--~---~~--~~p~~~~~~vyv~~~---~----------G~l~~~d~~tG~~~W~~ 305 (377)
T TIGR03300 257 DLRSGRVLWKRDA--S---SY--QGPAVDDNRLYVTDA---D----------GVVVALDRRSGSELWKN 305 (377)
T ss_pred ECCCCcEEEeecc--C---Cc--cCceEeCCEEEEECC---C----------CeEEEEECCCCcEEEcc
Confidence 7 4 34576631 1 11 123567889998752 1 26888998765 4754
No 58
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=96.99 E-value=0.24 Score=44.20 Aligned_cols=208 Identities=21% Similarity=0.281 Sum_probs=111.0
Q ss_pred ccccccccCC--CeEEccCCCCCccCCc--EEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCccce
Q 014195 91 TFQDLPAPEL--KWEKMKAAPVPRLDGA--AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSH 164 (429)
Q Consensus 91 ~~~~~d~~~~--~W~~~~~~p~~R~~~~--~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~ 164 (429)
.+..+|+.++ .|+.- +........ .+..++.+|+..+ ...+.++|+.+.+ |+.-. +. +..
T Consensus 4 ~l~~~d~~tG~~~W~~~--~~~~~~~~~~~~~~~~~~v~~~~~-------~~~l~~~d~~tG~~~W~~~~--~~---~~~ 69 (238)
T PF13360_consen 4 TLSALDPRTGKELWSYD--LGPGIGGPVATAVPDGGRVYVASG-------DGNLYALDAKTGKVLWRFDL--PG---PIS 69 (238)
T ss_dssp EEEEEETTTTEEEEEEE--CSSSCSSEEETEEEETTEEEEEET-------TSEEEEEETTTSEEEEEEEC--SS---CGG
T ss_pred EEEEEECCCCCEEEEEE--CCCCCCCccceEEEeCCEEEEEcC-------CCEEEEEECCCCCEEEEeec--cc---ccc
Confidence 3456666554 47662 211122222 3336888888742 2358999998875 66532 32 112
Q ss_pred eeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc--eE-eCCCCCC--CCCCceEEEECCEEEEEeCCCCCCCCccc
Q 014195 165 LGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK--WQ-DLPPLPV--PRYAPATQLWRGRLHVMGGSGENRYTPEV 239 (429)
Q Consensus 165 ~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~--W~-~~~~~p~--~r~~~~~~~~~~~lyv~GG~~~~~~~~~~ 239 (429)
...+..++.+|+... .+.++++|..+.+ |+ .....+. .+........++.+|+.... ..+
T Consensus 70 ~~~~~~~~~v~v~~~---------~~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~------g~l 134 (238)
T PF13360_consen 70 GAPVVDGGRVYVGTS---------DGSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTSS------GKL 134 (238)
T ss_dssp SGEEEETTEEEEEET---------TSEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEETC------SEE
T ss_pred ceeeecccccccccc---------eeeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEecc------CcE
Confidence 224778999988852 3478999987764 98 4433232 23344445557777776531 112
Q ss_pred cceEeeeecCCccccceeeccCCCCCCC--------ceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceE
Q 014195 240 DHWSLAVKDGKPLEKEWRTEIPIPRGGP--------HRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVY 311 (429)
Q Consensus 240 ~~~~~~~~~~d~~~~~W~~~~~~p~~~~--------~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~ 311 (429)
..++. +.....|+.....++... ....+..++.||+..+.. .+.
T Consensus 135 ~~~d~-----~tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~g-----------------------~~~ 186 (238)
T PF13360_consen 135 VALDP-----KTGKLLWKYPVGEPRGSSPISSFSDINGSPVISDGRVYVSSGDG-----------------------RVV 186 (238)
T ss_dssp EEEET-----TTTEEEEEEESSTT-SS--EEEETTEEEEEECCTTEEEEECCTS-----------------------SEE
T ss_pred EEEec-----CCCcEEEEeecCCCCCCcceeeecccccceEEECCEEEEEcCCC-----------------------eEE
Confidence 22221 122345776545544321 124444568888887653 144
Q ss_pred EeC-CCCC--eEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 312 MLD-DEMK--WKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 312 ~~d-~~~~--W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
.+| .+.+ |+.. +.. . .......++.||+.. .+ ..++.+|+++.+
T Consensus 187 ~~d~~tg~~~w~~~--~~~---~-~~~~~~~~~~l~~~~-~~------------~~l~~~d~~tG~ 233 (238)
T PF13360_consen 187 AVDLATGEKLWSKP--ISG---I-YSLPSVDGGTLYVTS-SD------------GRLYALDLKTGK 233 (238)
T ss_dssp EEETTTTEEEEEEC--SS----E-CECEECCCTEEEEEE-TT------------TEEEEEETTTTE
T ss_pred EEECCCCCEEEEec--CCC---c-cCCceeeCCEEEEEe-CC------------CEEEEEECCCCC
Confidence 456 4443 8543 221 1 111355667777766 32 279999999863
No 59
>PRK13684 Ycf48-like protein; Provisional
Probab=96.93 E-value=0.39 Score=45.63 Aligned_cols=237 Identities=11% Similarity=0.028 Sum_probs=113.2
Q ss_pred cCCCeEEccC-CCCCcc-CCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCC-CCCCccceeeE-EEeCCE
Q 014195 98 PELKWEKMKA-APVPRL-DGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDM-PREMAHSHLGM-VTDGRY 173 (429)
Q Consensus 98 ~~~~W~~~~~-~p~~R~-~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~-~~~~~r~~~~~-~~~~~~ 173 (429)
.-.+|+++.. ++..+. ..++...++..|++|. . ..+++=+-.-.+|+++... .. +.....+ +..++.
T Consensus 74 gG~tW~~~~~~~~~~~~~l~~v~~~~~~~~~~G~-~------g~i~~S~DgG~tW~~~~~~~~~--~~~~~~i~~~~~~~ 144 (334)
T PRK13684 74 GGETWEERSLDLPEENFRLISISFKGDEGWIVGQ-P------SLLLHTTDGGKNWTRIPLSEKL--PGSPYLITALGPGT 144 (334)
T ss_pred CCCCceECccCCcccccceeeeEEcCCcEEEeCC-C------ceEEEECCCCCCCeEccCCcCC--CCCceEEEEECCCc
Confidence 4468998653 332222 2233333555666642 1 1122222234589987532 11 1112223 333455
Q ss_pred EEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccc
Q 014195 174 IYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLE 253 (429)
Q Consensus 174 lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~ 253 (429)
+++.|. ...+++=+-.-.+|+.+.... .-..+.+....+..+++.|..+.-+.. + |...
T Consensus 145 ~~~~g~---------~G~i~~S~DgG~tW~~~~~~~-~g~~~~i~~~~~g~~v~~g~~G~i~~s----~-------~~gg 203 (334)
T PRK13684 145 AEMATN---------VGAIYRTTDGGKNWEALVEDA-AGVVRNLRRSPDGKYVAVSSRGNFYST----W-------EPGQ 203 (334)
T ss_pred ceeeec---------cceEEEECCCCCCceeCcCCC-cceEEEEEECCCCeEEEEeCCceEEEE----c-------CCCC
Confidence 666653 335555555678999886433 223344444444445544433321110 0 1334
Q ss_pred cceeeccCCCCCCCceeEE-EeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEE--eCCCCCeEEcCCCCCC-C
Q 014195 254 KEWRTEIPIPRGGPHRACV-VVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYM--LDDEMKWKVLPSMPKP-D 329 (429)
Q Consensus 254 ~~W~~~~~~p~~~~~~~~~-~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~--~d~~~~W~~~~~~~~~-r 329 (429)
.+|+.......... .+++ .-++.++++|... . +.. -|....|+.+.. |.. .
T Consensus 204 ~tW~~~~~~~~~~l-~~i~~~~~g~~~~vg~~G-~----------------------~~~~s~d~G~sW~~~~~-~~~~~ 258 (334)
T PRK13684 204 TAWTPHQRNSSRRL-QSMGFQPDGNLWMLARGG-Q----------------------IRFNDPDDLESWSKPII-PEITN 258 (334)
T ss_pred CeEEEeeCCCcccc-eeeeEcCCCCEEEEecCC-E----------------------EEEccCCCCCccccccC-Ccccc
Confidence 56877643222222 2333 3467788887532 1 221 125679997643 221 1
Q ss_pred CCcceeEE-EECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEeccc-CcceeeeeeE-EECCEEEEEcc
Q 014195 330 SHIEFAWV-LVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKL-PYRVKTTLAG-YWNGWLYFTSG 402 (429)
Q Consensus 330 ~~~~~~~~-~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~l-p~~r~~~~~~-~~~~~i~v~GG 402 (429)
...-++++ ..++.+|++|... .++.-.....+|+.+... ..+...+.++ ..+++.|+.|.
T Consensus 259 ~~~l~~v~~~~~~~~~~~G~~G-------------~v~~S~d~G~tW~~~~~~~~~~~~~~~~~~~~~~~~~~~G~ 321 (334)
T PRK13684 259 GYGYLDLAYRTPGEIWAGGGNG-------------TLLVSKDGGKTWEKDPVGEEVPSNFYKIVFLDPEKGFVLGQ 321 (334)
T ss_pred ccceeeEEEcCCCCEEEEcCCC-------------eEEEeCCCCCCCeECCcCCCCCcceEEEEEeCCCceEEECC
Confidence 11112222 3366888887532 344334455799987431 1222334444 45678888766
No 60
>PF07893 DUF1668: Protein of unknown function (DUF1668); InterPro: IPR012871 The hypothetical proteins found in this family are expressed by Oryza sativa (Rice) and are of unknown function.
Probab=96.09 E-value=0.11 Score=49.33 Aligned_cols=109 Identities=16% Similarity=0.184 Sum_probs=70.6
Q ss_pred cccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCcee----eeEEEE--EC--------CCCceeeCCC
Q 014195 90 ATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVH----SHVDIY--NF--------TDNTWGGRFD 155 (429)
Q Consensus 90 ~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~----~~~~~y--d~--------~~~~W~~~~~ 155 (429)
.....||..+..-..++.|+.+.....++.++++||++.......... ..+|++ ++ ..-.|+.+++
T Consensus 86 ~~t~vyDt~t~av~~~P~l~~pk~~pisv~VG~~LY~m~~~~~~~~~~~~~~~~FE~l~~~~~~~~~~~~~~w~W~~LP~ 165 (342)
T PF07893_consen 86 GRTLVYDTDTRAVATGPRLHSPKRCPISVSVGDKLYAMDRSPFPEPAGRPDFPCFEALVYRPPPDDPSPEESWSWRSLPP 165 (342)
T ss_pred CCeEEEECCCCeEeccCCCCCCCcceEEEEeCCeEEEeeccCccccccCccceeEEEeccccccccccCCCcceEEcCCC
Confidence 346789999988777788777766667778899999998874332110 045555 42 1225788877
Q ss_pred CCCCCc-------cceeeEEEeCCEEEEE-eCeeCCCCCCCCceeEEEeCCCCceEeCCC
Q 014195 156 MPREMA-------HSHLGMVTDGRYIYVV-TGQYGPQCRGPTAHTFVLDTETKKWQDLPP 207 (429)
Q Consensus 156 ~~~~~~-------r~~~~~~~~~~~lyv~-GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~ 207 (429)
.|.... ...++++ .+..|||- -|. ..-.+.||..+.+|++..+
T Consensus 166 PPf~~~~~~~~~~i~sYavv-~g~~I~vS~~~~--------~~GTysfDt~~~~W~~~Gd 216 (342)
T PF07893_consen 166 PPFVRDRRYSDYRITSYAVV-DGRTIFVSVNGR--------RWGTYSFDTESHEWRKHGD 216 (342)
T ss_pred CCccccCCcccceEEEEEEe-cCCeEEEEecCC--------ceEEEEEEcCCcceeeccc
Confidence 554221 1223333 47789983 221 1248899999999999975
No 61
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=96.05 E-value=0.17 Score=46.36 Aligned_cols=119 Identities=17% Similarity=0.187 Sum_probs=68.3
Q ss_pred EEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEE-CCEEEEEeCCCCCC-CCccccceEeeeecCCccc
Q 014195 176 VVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLW-RGRLHVMGGSGENR-YTPEVDHWSLAVKDGKPLE 253 (429)
Q Consensus 176 v~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~-~~~lyv~GG~~~~~-~~~~~~~~~~~~~~~d~~~ 253 (429)
++||.......-+...+..||.++.+|..+..--... -.++... +++||+.|-..... .....-.| |..+
T Consensus 2 ~VGG~F~~aGsL~C~~lC~yd~~~~qW~~~g~~i~G~-V~~l~~~~~~~Llv~G~ft~~~~~~~~la~y-------d~~~ 73 (281)
T PF12768_consen 2 YVGGSFTSAGSLPCPGLCLYDTDNSQWSSPGNGISGT-VTDLQWASNNQLLVGGNFTLNGTNSSNLATY-------DFKN 73 (281)
T ss_pred EEeeecCCCCCcCCCEEEEEECCCCEeecCCCCceEE-EEEEEEecCCEEEEEEeeEECCCCceeEEEE-------ecCC
Confidence 3566544333223788999999999999986432221 1233333 77888887654332 22223333 4778
Q ss_pred cceeeccC-----CCCCCCceeEEE---eCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeCCCCCeEEcCC
Q 014195 254 KEWRTEIP-----IPRGGPHRACVV---VDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLDDEMKWKVLPS 324 (429)
Q Consensus 254 ~~W~~~~~-----~p~~~~~~~~~~---~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W~~~~~ 324 (429)
++|..... +|.... +... -.+.+++.|..... ..-+..| +..+|+.+..
T Consensus 74 ~~w~~~~~~~s~~ipgpv~--a~~~~~~d~~~~~~aG~~~~g-------------------~~~l~~~-dGs~W~~i~~ 130 (281)
T PF12768_consen 74 QTWSSLGGGSSNSIPGPVT--ALTFISNDGSNFWVAGRSANG-------------------STFLMKY-DGSSWSSIGS 130 (281)
T ss_pred CeeeecCCcccccCCCcEE--EEEeeccCCceEEEeceecCC-------------------CceEEEE-cCCceEeccc
Confidence 99987655 233321 2222 13458887765211 1237777 5779998875
No 62
>PF12768 Rax2: Cortical protein marker for cell polarity
Probab=95.92 E-value=0.11 Score=47.58 Aligned_cols=108 Identities=12% Similarity=0.133 Sum_probs=64.3
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC-----CCCC
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP-----LPVP 211 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~-----~p~~ 211 (429)
..+..||+.+.+|..+..--. -.-.++... +++||+.|-..-... ....+-.||.++++|+.++. +|.+
T Consensus 16 ~~lC~yd~~~~qW~~~g~~i~---G~V~~l~~~~~~~Llv~G~ft~~~~--~~~~la~yd~~~~~w~~~~~~~s~~ipgp 90 (281)
T PF12768_consen 16 PGLCLYDTDNSQWSSPGNGIS---GTVTDLQWASNNQLLVGGNFTLNGT--NSSNLATYDFKNQTWSSLGGGSSNSIPGP 90 (281)
T ss_pred CEEEEEECCCCEeecCCCCce---EEEEEEEEecCCEEEEEEeeEECCC--CceeEEEEecCCCeeeecCCcccccCCCc
Confidence 459999999999998754322 122344444 778887775544331 15678899999999998865 3444
Q ss_pred CCCceEEEEC-CEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccC
Q 014195 212 RYAPATQLWR-GRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIP 261 (429)
Q Consensus 212 r~~~~~~~~~-~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~ 261 (429)
....+....+ .++++.|.... -....-.|+ ..+|+.+..
T Consensus 91 v~a~~~~~~d~~~~~~aG~~~~--g~~~l~~~d---------Gs~W~~i~~ 130 (281)
T PF12768_consen 91 VTALTFISNDGSNFWVAGRSAN--GSTFLMKYD---------GSSWSSIGS 130 (281)
T ss_pred EEEEEeeccCCceEEEeceecC--CCceEEEEc---------CCceEeccc
Confidence 3222222223 45777766421 122233333 667887654
No 63
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=95.85 E-value=1.2 Score=39.54 Aligned_cols=161 Identities=20% Similarity=0.218 Sum_probs=87.1
Q ss_pred eeeeecCCCCe--EEecCCCCCCCcce--eeeecCCCCcCcccccccccccccCC--CeEEccCCCCCccCCcEEEECCE
Q 014195 50 IASNWSPYHNS--IILPNNGPQKGENI--GVKTKKDVVPKRILPATFQDLPAPEL--KWEKMKAAPVPRLDGAAIQIKNL 123 (429)
Q Consensus 50 ~~~~yd~~~~~--~~~p~~~~r~~~~~--~~~~~~~~~~~~~~~~~~~~~d~~~~--~W~~~~~~p~~R~~~~~~~~~~~ 123 (429)
.+..+|+.+.+ ...+-. +...... ....+...... .....+..+|..++ .|+.-. +. +........++.
T Consensus 4 ~l~~~d~~tG~~~W~~~~~-~~~~~~~~~~~~~~~~v~~~-~~~~~l~~~d~~tG~~~W~~~~--~~-~~~~~~~~~~~~ 78 (238)
T PF13360_consen 4 TLSALDPRTGKELWSYDLG-PGIGGPVATAVPDGGRVYVA-SGDGNLYALDAKTGKVLWRFDL--PG-PISGAPVVDGGR 78 (238)
T ss_dssp EEEEEETTTTEEEEEEECS-SSCSSEEETEEEETTEEEEE-ETTSEEEEEETTTSEEEEEEEC--SS-CGGSGEEEETTE
T ss_pred EEEEEECCCCCEEEEEECC-CCCCCccceEEEeCCEEEEE-cCCCEEEEEECCCCCEEEEeec--cc-cccceeeecccc
Confidence 56888988888 443321 1122222 22223211111 25566778887665 465533 22 222224667889
Q ss_pred EEEEeccCCCCceeeeEEEEECCCCc--ee-eCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 124 LYVFAGYGSIDYVHSHVDIYNFTDNT--WG-GRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 124 iyv~GG~~~~~~~~~~~~~yd~~~~~--W~-~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
||+.... +.++++|..+.+ |+ .....+....+......+.++.+|+... ...+.++|+++.
T Consensus 79 v~v~~~~-------~~l~~~d~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~---------~g~l~~~d~~tG 142 (238)
T PF13360_consen 79 VYVGTSD-------GSLYALDAKTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTS---------SGKLVALDPKTG 142 (238)
T ss_dssp EEEEETT-------SEEEEEETTTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEET---------CSEEEEEETTTT
T ss_pred cccccce-------eeeEecccCCcceeeeeccccccccccccccCceEecCEEEEEec---------cCcEEEEecCCC
Confidence 9887621 258999988775 88 3433222112344455566888877643 357899999976
Q ss_pred c--eEeCCCCCCCC--------CCceEEEECCEEEEEeCCC
Q 014195 201 K--WQDLPPLPVPR--------YAPATQLWRGRLHVMGGSG 231 (429)
Q Consensus 201 ~--W~~~~~~p~~r--------~~~~~~~~~~~lyv~GG~~ 231 (429)
+ |+.-...+... .....+..++.+|+..+..
T Consensus 143 ~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~g 183 (238)
T PF13360_consen 143 KLLWKYPVGEPRGSSPISSFSDINGSPVISDGRVYVSSGDG 183 (238)
T ss_dssp EEEEEEESSTT-SS--EEEETTEEEEEECCTTEEEEECCTS
T ss_pred cEEEEeecCCCCCCcceeeecccccceEEECCEEEEEcCCC
Confidence 5 77644333211 1233334467888886643
No 64
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=95.68 E-value=1.3 Score=39.90 Aligned_cols=86 Identities=22% Similarity=0.144 Sum_probs=51.4
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe--CCEEEEEeCeeCCCCCCCCceeEEEeCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD--GRYIYVVTGQYGPQCRGPTAHTFVLDTE 198 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~yd~~ 198 (429)
++.||+.--. ...++++|+.+++-..+. .+. ..++++. ++.+|+... .....+|+.
T Consensus 11 ~g~l~~~D~~------~~~i~~~~~~~~~~~~~~-~~~-----~~G~~~~~~~g~l~v~~~----------~~~~~~d~~ 68 (246)
T PF08450_consen 11 DGRLYWVDIP------GGRIYRVDPDTGEVEVID-LPG-----PNGMAFDRPDGRLYVADS----------GGIAVVDPD 68 (246)
T ss_dssp TTEEEEEETT------TTEEEEEETTTTEEEEEE-SSS-----EEEEEEECTTSEEEEEET----------TCEEEEETT
T ss_pred CCEEEEEEcC------CCEEEEEECCCCeEEEEe-cCC-----CceEEEEccCCEEEEEEc----------CceEEEecC
Confidence 4677776322 235899999998765532 222 2334444 788888743 234566999
Q ss_pred CCceEeCCCCC-----CCCCCceEEEECCEEEEEe
Q 014195 199 TKKWQDLPPLP-----VPRYAPATQLWRGRLHVMG 228 (429)
Q Consensus 199 t~~W~~~~~~p-----~~r~~~~~~~~~~~lyv~G 228 (429)
+.+++.+...+ ..+..-.++.-++.||+--
T Consensus 69 ~g~~~~~~~~~~~~~~~~~~ND~~vd~~G~ly~t~ 103 (246)
T PF08450_consen 69 TGKVTVLADLPDGGVPFNRPNDVAVDPDGNLYVTD 103 (246)
T ss_dssp TTEEEEEEEEETTCSCTEEEEEEEE-TTS-EEEEE
T ss_pred CCcEEEEeeccCCCcccCCCceEEEcCCCCEEEEe
Confidence 99998886542 2333333444478888864
No 65
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=94.84 E-value=1.2 Score=42.68 Aligned_cols=139 Identities=16% Similarity=0.117 Sum_probs=74.9
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCC-CCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPR-EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~-~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
.-.+.+++|.++.- .++..|-++|. .+.++.. ..|-.....+..+....+++|+ ..-++.||.++
T Consensus 224 ~~plllvaG~d~~l----rifqvDGk~N~--~lqS~~l~~fPi~~a~f~p~G~~~i~~s~r--------rky~ysyDle~ 289 (514)
T KOG2055|consen 224 TAPLLLVAGLDGTL----RIFQVDGKVNP--KLQSIHLEKFPIQKAEFAPNGHSVIFTSGR--------RKYLYSYDLET 289 (514)
T ss_pred CCceEEEecCCCcE----EEEEecCccCh--hheeeeeccCccceeeecCCCceEEEeccc--------ceEEEEeeccc
Confidence 34688999987642 36667777776 4433322 1122233333344447777775 45788999999
Q ss_pred CceEeCCCCC--CCCCCce-EEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCC
Q 014195 200 KKWQDLPPLP--VPRYAPA-TQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDD 276 (429)
Q Consensus 200 ~~W~~~~~~p--~~r~~~~-~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~ 276 (429)
.+-+++.++- ..+..+. -+..++.+.++-|..+.-+. +. ..++.|-....++-.....+....+.
T Consensus 290 ak~~k~~~~~g~e~~~~e~FeVShd~~fia~~G~~G~I~l-------Lh-----akT~eli~s~KieG~v~~~~fsSdsk 357 (514)
T KOG2055|consen 290 AKVTKLKPPYGVEEKSMERFEVSHDSNFIAIAGNNGHIHL-------LH-----AKTKELITSFKIEGVVSDFTFSSDSK 357 (514)
T ss_pred cccccccCCCCcccchhheeEecCCCCeEEEcccCceEEe-------eh-----hhhhhhhheeeeccEEeeEEEecCCc
Confidence 9998887543 1222222 34556677777776542211 10 33444544333332222222222344
Q ss_pred EEEEEcccC
Q 014195 277 RLLVIGGQE 285 (429)
Q Consensus 277 ~iyv~GG~~ 285 (429)
.|++.||..
T Consensus 358 ~l~~~~~~G 366 (514)
T KOG2055|consen 358 ELLASGGTG 366 (514)
T ss_pred EEEEEcCCc
Confidence 588888864
No 66
>cd00094 HX Hemopexin-like repeats.; Hemopexin is a heme-binding protein that transports heme to the liver. Hemopexin-like repeats occur in vitronectin and some matrix metalloproteinases family (matrixins). The HX repeats of some matrixins bind tissue inhibitor of metalloproteinases (TIMPs). This CD contains 4 instances of the repeat.
Probab=94.50 E-value=1.7 Score=37.69 Aligned_cols=48 Identities=25% Similarity=0.478 Sum_probs=29.3
Q ss_pred CCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEE-----e----cccCcceeeeeeEEEC-CEEEEEccc
Q 014195 340 NNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHV-----I----GKLPYRVKTTLAGYWN-GWLYFTSGQ 403 (429)
Q Consensus 340 ~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~-----v----~~lp~~r~~~~~~~~~-~~i~v~GG~ 403 (429)
++++|+|-|. ..|+||..+++... + ..+|.. -.++.... +++|+|-|.
T Consensus 110 ~~~~yfFkg~--------------~y~ry~~~~~~v~~~yP~~i~~~w~g~p~~--idaa~~~~~~~~yfF~g~ 167 (194)
T cd00094 110 NGKTYFFKGD--------------KYWRYDEKTQKMDPGYPKLIETDFPGVPDK--VDAAFRWLDGYYYFFKGD 167 (194)
T ss_pred CCEEEEEeCC--------------EEEEEeCCCccccCCCCcchhhcCCCcCCC--cceeEEeCCCcEEEEECC
Confidence 5899999874 57888876654321 1 223322 22343344 899999883
No 67
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=94.39 E-value=4 Score=37.32 Aligned_cols=139 Identities=17% Similarity=0.107 Sum_probs=63.4
Q ss_pred eeeeecCCCcccceeeeeeecCCCCe--EEecC-CCCCCCcceeeeecC-CCCcCcccccccccccccCCCeEE-ccCCC
Q 014195 35 FFWASSSKFTSSYLNIASNWSPYHNS--IILPN-NGPQKGENIGVKTKK-DVVPKRILPATFQDLPAPELKWEK-MKAAP 109 (429)
Q Consensus 35 ~ly~~GG~~~~~~~~~~~~yd~~~~~--~~~p~-~~~r~~~~~~~~~~~-~~~~~~~~~~~~~~~d~~~~~W~~-~~~~p 109 (429)
.+|+.++.++ .+..||+.++. ..+.. ..++ ++...... ...........+..+|..+.+... +....
T Consensus 2 ~~~~s~~~d~-----~v~~~d~~t~~~~~~~~~~~~~~---~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~~~~~~~~~~ 73 (300)
T TIGR03866 2 KAYVSNEKDN-----TISVIDTATLEVTRTFPVGQRPR---GITLSKDGKLLYVCASDSDTIQVIDLATGEVIGTLPSGP 73 (300)
T ss_pred cEEEEecCCC-----EEEEEECCCCceEEEEECCCCCC---ceEECCCCCEEEEEECCCCeEEEEECCCCcEEEeccCCC
Confidence 5778787665 67888988776 22222 1111 12221111 110001123456677777665433 22111
Q ss_pred CCccCCcEEEE-C-CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEE-eCCEEEEEeCeeCCCCC
Q 014195 110 VPRLDGAAIQI-K-NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVT-DGRYIYVVTGQYGPQCR 186 (429)
Q Consensus 110 ~~R~~~~~~~~-~-~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~-~~~~lyv~GG~~~~~~~ 186 (429)
.+ ..++.. + +.+|+.++.+ ..+.+||+.+.+-. ..++.. ....+++. -++.+++++..+
T Consensus 74 ~~---~~~~~~~~g~~l~~~~~~~------~~l~~~d~~~~~~~--~~~~~~--~~~~~~~~~~dg~~l~~~~~~----- 135 (300)
T TIGR03866 74 DP---ELFALHPNGKILYIANEDD------NLVTVIDIETRKVL--AEIPVG--VEPEGMAVSPDGKIVVNTSET----- 135 (300)
T ss_pred Cc---cEEEECCCCCEEEEEcCCC------CeEEEEECCCCeEE--eEeeCC--CCcceEEECCCCCEEEEEecC-----
Confidence 11 122222 3 3566665432 24888999876422 222211 11122333 355666665421
Q ss_pred CCCceeEEEeCCCCc
Q 014195 187 GPTAHTFVLDTETKK 201 (429)
Q Consensus 187 ~~~~~~~~yd~~t~~ 201 (429)
.+.+..||..+.+
T Consensus 136 --~~~~~~~d~~~~~ 148 (300)
T TIGR03866 136 --TNMAHFIDTKTYE 148 (300)
T ss_pred --CCeEEEEeCCCCe
Confidence 1245567876654
No 68
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=94.22 E-value=5.8 Score=38.56 Aligned_cols=92 Identities=12% Similarity=0.061 Sum_probs=47.3
Q ss_pred ccCCCeEEccCCCC----Cc--cCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe
Q 014195 97 APELKWEKMKAAPV----PR--LDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD 170 (429)
Q Consensus 97 ~~~~~W~~~~~~p~----~R--~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~ 170 (429)
....+|++.. .|. .+ ...++...++..|++|-. + .+..=+-.-++|+.++..+..........+.-
T Consensus 117 DGG~tW~~~~-~~~~~~~~~~~~l~~v~f~~~~g~~vG~~-G------~il~T~DgG~tW~~~~~~~~~p~~~~~i~~~~ 188 (398)
T PLN00033 117 DGGKTWVPRS-IPSAEDEDFNYRFNSISFKGKEGWIIGKP-A------ILLHTSDGGETWERIPLSPKLPGEPVLIKATG 188 (398)
T ss_pred CCCCCceECc-cCcccccccccceeeeEEECCEEEEEcCc-e------EEEEEcCCCCCceECccccCCCCCceEEEEEC
Confidence 3456898854 221 11 224444557778887521 1 12222334578998754322111222222333
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeC
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDL 205 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~ 205 (429)
++.++++|. ...+++-+-.-.+|+.+
T Consensus 189 ~~~~~ivg~---------~G~v~~S~D~G~tW~~~ 214 (398)
T PLN00033 189 PKSAEMVTD---------EGAIYVTSNAGRNWKAA 214 (398)
T ss_pred CCceEEEec---------cceEEEECCCCCCceEc
Confidence 456777763 23465655566789987
No 69
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=93.84 E-value=4.5 Score=35.95 Aligned_cols=64 Identities=9% Similarity=0.081 Sum_probs=32.5
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
++..+++++.+ ..+.+||..+++.... +... ...-.++... ++.+++.++. ...+..||+.+
T Consensus 62 ~~~~l~~~~~~------~~i~i~~~~~~~~~~~--~~~~-~~~i~~~~~~~~~~~~~~~~~--------~~~i~~~~~~~ 124 (289)
T cd00200 62 DGTYLASGSSD------KTIRLWDLETGECVRT--LTGH-TSYVSSVAFSPDGRILSSSSR--------DKTIKVWDVET 124 (289)
T ss_pred CCCEEEEEcCC------CeEEEEEcCcccceEE--Eecc-CCcEEEEEEcCCCCEEEEecC--------CCeEEEEECCC
Confidence 34466666653 2478888887532221 1110 1112233333 3456666652 34677888875
Q ss_pred Cc
Q 014195 200 KK 201 (429)
Q Consensus 200 ~~ 201 (429)
.+
T Consensus 125 ~~ 126 (289)
T cd00200 125 GK 126 (289)
T ss_pred cE
Confidence 44
No 70
>PRK13684 Ycf48-like protein; Provisional
Probab=93.53 E-value=7 Score=37.11 Aligned_cols=235 Identities=13% Similarity=0.155 Sum_probs=111.8
Q ss_pred cCCCeEEccCCCCCccCCcEEEEC-CEEEEEeccCCCCceeeeEEEEECCCCceeeCCC-CCCCCccceeeEEEeCCEEE
Q 014195 98 PELKWEKMKAAPVPRLDGAAIQIK-NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFD-MPREMAHSHLGMVTDGRYIY 175 (429)
Q Consensus 98 ~~~~W~~~~~~p~~R~~~~~~~~~-~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~-~~~~~~r~~~~~~~~~~~ly 175 (429)
....|+.+. +|.......++..+ +..|++|- . . .++.=+-.-++|+++.. ++.. ...-.++...++..|
T Consensus 33 ~~~~W~~~~-~~~~~~l~~v~F~d~~~g~avG~-~--G----~il~T~DgG~tW~~~~~~~~~~-~~~l~~v~~~~~~~~ 103 (334)
T PRK13684 33 SSSPWQVID-LPTEANLLDIAFTDPNHGWLVGS-N--R----TLLETNDGGETWEERSLDLPEE-NFRLISISFKGDEGW 103 (334)
T ss_pred cCCCcEEEe-cCCCCceEEEEEeCCCcEEEEEC-C--C----EEEEEcCCCCCceECccCCccc-ccceeeeEEcCCcEE
Confidence 445797765 44433444455554 46676662 1 1 12222223468998643 3221 122233444455667
Q ss_pred EEeCeeCCCCCCCCceeEEEeCCCCceEeCCCC-CCCCCCceEEEE-CCEEEEEeCCCCCCCCccccceEeeeecCCccc
Q 014195 176 VVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPL-PVPRYAPATQLW-RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLE 253 (429)
Q Consensus 176 v~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~-p~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~ 253 (429)
++|. ...+++=+-.-.+|+++... ..+.....+..+ ++.+++.|... ..|.- +..-
T Consensus 104 ~~G~---------~g~i~~S~DgG~tW~~~~~~~~~~~~~~~i~~~~~~~~~~~g~~G--------~i~~S-----~DgG 161 (334)
T PRK13684 104 IVGQ---------PSLLLHTTDGGKNWTRIPLSEKLPGSPYLITALGPGTAEMATNVG--------AIYRT-----TDGG 161 (334)
T ss_pred EeCC---------CceEEEECCCCCCCeEccCCcCCCCCceEEEEECCCcceeeeccc--------eEEEE-----CCCC
Confidence 6652 22344433334689988521 222222333333 34466655322 12221 1346
Q ss_pred cceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEe-C-CCCCeEEcCCCCCCCCC
Q 014195 254 KEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYML-D-DEMKWKVLPSMPKPDSH 331 (429)
Q Consensus 254 ~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~-d-~~~~W~~~~~~~~~r~~ 331 (429)
++|+........ .-..+....+..++..|..+. ++.. | ...+|+.+.. +..+..
T Consensus 162 ~tW~~~~~~~~g-~~~~i~~~~~g~~v~~g~~G~----------------------i~~s~~~gg~tW~~~~~-~~~~~l 217 (334)
T PRK13684 162 KNWEALVEDAAG-VVRNLRRSPDGKYVAVSSRGN----------------------FYSTWEPGQTAWTPHQR-NSSRRL 217 (334)
T ss_pred CCceeCcCCCcc-eEEEEEECCCCeEEEEeCCce----------------------EEEEcCCCCCeEEEeeC-CCcccc
Confidence 788876543322 223444444445555444332 4443 3 4568999854 333332
Q ss_pred cceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEE--ecCCCCeEEecccCcc---eeeeeeE-EECCEEEEEccc
Q 014195 332 IEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQF--NLNTLKWHVIGKLPYR---VKTTLAG-YWNGWLYFTSGQ 403 (429)
Q Consensus 332 ~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~y--d~~~~~W~~v~~lp~~---r~~~~~~-~~~~~i~v~GG~ 403 (429)
... ....+++++++|... ...+ +-...+|+.+. .|.. ...+++. ..++.++++|..
T Consensus 218 ~~i-~~~~~g~~~~vg~~G--------------~~~~~s~d~G~sW~~~~-~~~~~~~~~l~~v~~~~~~~~~~~G~~ 279 (334)
T PRK13684 218 QSM-GFQPDGNLWMLARGG--------------QIRFNDPDDLESWSKPI-IPEITNGYGYLDLAYRTPGEIWAGGGN 279 (334)
T ss_pred eee-eEcCCCCEEEEecCC--------------EEEEccCCCCCcccccc-CCccccccceeeEEEcCCCCEEEEcCC
Confidence 222 234577888887431 1223 22345898753 2311 1123332 236678888654
No 71
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=93.33 E-value=7.3 Score=36.73 Aligned_cols=95 Identities=8% Similarity=0.051 Sum_probs=43.3
Q ss_pred ccccccccc-CCCeEEccCCCCCccCCcEEEE-CC-EEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCccce
Q 014195 90 ATFQDLPAP-ELKWEKMKAAPVPRLDGAAIQI-KN-LLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSH 164 (429)
Q Consensus 90 ~~~~~~d~~-~~~W~~~~~~p~~R~~~~~~~~-~~-~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~ 164 (429)
..+..|+.. ..+++.+...+.+..-+.++.. ++ .+|+.. .. .+.+.+||..++. .+.+..++. ....
T Consensus 57 ~~i~~~~~~~~g~l~~~~~~~~~~~p~~i~~~~~g~~l~v~~-~~-----~~~v~v~~~~~~g~~~~~~~~~~~--~~~~ 128 (330)
T PRK11028 57 FRVLSYRIADDGALTFAAESPLPGSPTHISTDHQGRFLFSAS-YN-----ANCVSVSPLDKDGIPVAPIQIIEG--LEGC 128 (330)
T ss_pred CcEEEEEECCCCceEEeeeecCCCCceEEEECCCCCEEEEEE-cC-----CCeEEEEEECCCCCCCCceeeccC--CCcc
Confidence 444445443 3456555443332222223333 34 566653 22 1346778775431 122222222 1122
Q ss_pred eeEEEe--CCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 165 LGMVTD--GRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 165 ~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
|++++. +..+|+..-. .+.+.+||..+.
T Consensus 129 ~~~~~~p~g~~l~v~~~~--------~~~v~v~d~~~~ 158 (330)
T PRK11028 129 HSANIDPDNRTLWVPCLK--------EDRIRLFTLSDD 158 (330)
T ss_pred cEeEeCCCCCEEEEeeCC--------CCEEEEEEECCC
Confidence 344333 4467665321 467889998763
No 72
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=93.30 E-value=6.3 Score=35.96 Aligned_cols=66 Identities=15% Similarity=0.244 Sum_probs=37.0
Q ss_pred EEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCce
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKW 202 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W 202 (429)
.+|+.++.++ .+.+||+.+++-...-..... ++ .......+..+|+.++. ...+..||..+.+.
T Consensus 2 ~~~~s~~~d~------~v~~~d~~t~~~~~~~~~~~~-~~-~l~~~~dg~~l~~~~~~--------~~~v~~~d~~~~~~ 65 (300)
T TIGR03866 2 KAYVSNEKDN------TISVIDTATLEVTRTFPVGQR-PR-GITLSKDGKLLYVCASD--------SDTIQVIDLATGEV 65 (300)
T ss_pred cEEEEecCCC------EEEEEECCCCceEEEEECCCC-CC-ceEECCCCCEEEEEECC--------CCeEEEEECCCCcE
Confidence 5677776543 488899887764332222111 12 12222224467777652 35688899988766
Q ss_pred Ee
Q 014195 203 QD 204 (429)
Q Consensus 203 ~~ 204 (429)
..
T Consensus 66 ~~ 67 (300)
T TIGR03866 66 IG 67 (300)
T ss_pred EE
Confidence 44
No 73
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=93.16 E-value=2.1 Score=41.18 Aligned_cols=134 Identities=14% Similarity=0.109 Sum_probs=75.6
Q ss_pred CCEEEEEeCCCCCCCCccccceEeeeecCCccccceee---ccCCCCCCCceeEEEeCCE-EEEEcccCCCCCCCCCCCc
Q 014195 221 RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRT---EIPIPRGGPHRACVVVDDR-LLVIGGQEGDFMAKPGSPI 296 (429)
Q Consensus 221 ~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~---~~~~p~~~~~~~~~~~~~~-iyv~GG~~~~~~~~~~~~~ 296 (429)
.-.+.+++|.++ ....|.++ -+++.--+ +...|... +...-+|+ ..+++|....
T Consensus 224 ~~plllvaG~d~-----~lrifqvD-----Gk~N~~lqS~~l~~fPi~~---a~f~p~G~~~i~~s~rrky--------- 281 (514)
T KOG2055|consen 224 TAPLLLVAGLDG-----TLRIFQVD-----GKVNPKLQSIHLEKFPIQK---AEFAPNGHSVIFTSGRRKY--------- 281 (514)
T ss_pred CCceEEEecCCC-----cEEEEEec-----CccChhheeeeeccCccce---eeecCCCceEEEecccceE---------
Confidence 456888888764 34444432 33333222 12223332 33344666 7777876422
Q ss_pred cccccCCeeeeCceEEeC-CCCCeEEcCCC---CCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCC
Q 014195 297 FKCSRRNEVVYDDVYMLD-DEMKWKVLPSM---PKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNT 372 (429)
Q Consensus 297 ~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~---~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~ 372 (429)
+|.|| .+.+-+++.++ ++ +.-..+. +..++.++++-|.++ -|.++...+
T Consensus 282 -------------~ysyDle~ak~~k~~~~~g~e~-~~~e~Fe-VShd~~fia~~G~~G------------~I~lLhakT 334 (514)
T KOG2055|consen 282 -------------LYSYDLETAKVTKLKPPYGVEE-KSMERFE-VSHDSNFIAIAGNNG------------HIHLLHAKT 334 (514)
T ss_pred -------------EEEeeccccccccccCCCCccc-chhheeE-ecCCCCeEEEcccCc------------eEEeehhhh
Confidence 78899 88888888754 22 2222333 555666666666653 578888888
Q ss_pred CCeEEecccCcceeeeeeEEECCEEEEEccc
Q 014195 373 LKWHVIGKLPYRVKTTLAGYWNGWLYFTSGQ 403 (429)
Q Consensus 373 ~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG~ 403 (429)
+.|-.--.++-.....+...-+.+|++.||.
T Consensus 335 ~eli~s~KieG~v~~~~fsSdsk~l~~~~~~ 365 (514)
T KOG2055|consen 335 KELITSFKIEGVVSDFTFSSDSKELLASGGT 365 (514)
T ss_pred hhhhheeeeccEEeeEEEecCCcEEEEEcCC
Confidence 8885443444433444444344567777774
No 74
>PF12217 End_beta_propel: Catalytic beta propeller domain of bacteriophage endosialidase; InterPro: IPR024428 This entry represents the beta propeller domain of endosialidases, which consists of catalytically active part of the enzymes. This core domain forms stable SDS-resistant trimers. There is a nested beta barrel domain in this domain. This domain is typically between 443 and 460 amino acids in length [].; PDB: 1V0E_B 1V0F_E 3JU4_A 3GVL_A 3GVK_B 3GVJ_A.
Probab=93.12 E-value=6.1 Score=35.27 Aligned_cols=268 Identities=13% Similarity=0.157 Sum_probs=112.3
Q ss_pred EEEECCEEEE--Eecc-CCCCceeeeEEEEEC-CCCceee---CCCCCC--C-CccceeeEEEeCCEEEEEeCeeCCCCC
Q 014195 117 AIQIKNLLYV--FAGY-GSIDYVHSHVDIYNF-TDNTWGG---RFDMPR--E-MAHSHLGMVTDGRYIYVVTGQYGPQCR 186 (429)
Q Consensus 117 ~~~~~~~iyv--~GG~-~~~~~~~~~~~~yd~-~~~~W~~---~~~~~~--~-~~r~~~~~~~~~~~lyv~GG~~~~~~~ 186 (429)
+.++++-||. .+|. .+-+. +.-.|+=.- ..++|+. +.++.. | ..-.++++-+++++||.+=-......
T Consensus 21 aFVy~~VIYAPfM~~~RHGv~~-LhvaWVkSgDdG~TWttPEwLtd~H~~yptvnyHCmSMGv~~NRLfa~iEtR~~a~- 98 (367)
T PF12217_consen 21 AFVYDNVIYAPFMAGDRHGVDN-LHVAWVKSGDDGQTWTTPEWLTDLHPDYPTVNYHCMSMGVVGNRLFAVIETRTVAS- 98 (367)
T ss_dssp -EEETTEEEEEEEEESSSSSTT--EEEEEEESSTTSS----EESS---TTTTTEEEE-B-EEEETTEEEEEEEEEETTT-
T ss_pred ceeecCeeecccccccccCccc-eEEEEEEecCCCCcccCchhhhhcCCCCCccceeeeeeeeecceeeEEEeehhhhh-
Confidence 4566777775 3333 22222 121233322 3567864 233321 1 12345677788999998743322111
Q ss_pred CCCceeEEEe---CCCCceEeC--CCCCC-------CCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcccc
Q 014195 187 GPTAHTFVLD---TETKKWQDL--PPLPV-------PRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEK 254 (429)
Q Consensus 187 ~~~~~~~~yd---~~t~~W~~~--~~~p~-------~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~ 254 (429)
......+.|| ...+.|+.. +..|. .-.-|+.+.+++.-|.+|=.++...-......-+. -.++....
T Consensus 99 ~km~~~~Lw~RpMF~~spW~~teL~~~~~~~~a~~~vTe~HSFa~i~~~~fA~GyHnGD~sPRe~G~~yfs-~~~~sp~~ 177 (367)
T PF12217_consen 99 NKMVRAELWSRPMFHDSPWRITELGTIASFTSAGVAVTELHSFATIDDNQFAVGYHNGDVSPRELGFLYFS-DAFASPGV 177 (367)
T ss_dssp --EEEEEEEEEE-STTS--EEEEEES-TT--------SEEEEEEE-SSS-EEEEEEE-SSSS-EEEEEEET-TTTT-TT-
T ss_pred hhhhhhhhhcccccccCCceeeecccccccccccceeeeeeeeeEecCCceeEEeccCCCCcceeeEEEec-ccccCCcc
Confidence 1134455554 356778754 33332 34557788888888888854433211112111110 00000000
Q ss_pred ce-ee-ccCCCCCCCceeEEEeCCEEEEEc-ccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCC
Q 014195 255 EW-RT-EIPIPRGGPHRACVVVDDRLLVIG-GQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDS 330 (429)
Q Consensus 255 ~W-~~-~~~~p~~~~~~~~~~~~~~iyv~G-G~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~ 330 (429)
.= +. .....+..+..++-.+++.||+.- |..+.. +-..+.+-+ ....|+.+.- |....
T Consensus 178 ~vrr~i~sey~~~AsEPCvkyY~g~LyLtTRgt~~~~-----------------~GS~L~rs~d~G~~w~slrf-p~nvH 239 (367)
T PF12217_consen 178 FVRRIIPSEYERNASEPCVKYYDGVLYLTTRGTLPTN-----------------PGSSLHRSDDNGQNWSSLRF-PNNVH 239 (367)
T ss_dssp -EEEE--GGG-TTEEEEEEEEETTEEEEEEEES-TTS--------------------EEEEESSTTSS-EEEE--TT---
T ss_pred eeeeechhhhccccccchhhhhCCEEEEEEcCcCCCC-----------------CcceeeeecccCCchhhccc-ccccc
Confidence 00 11 222344444566778899999986 333221 112355666 7788998752 22222
Q ss_pred CcceeEEEECCEEEEEcccCCCCCC-----------ccceeeeCcE--EEEecCCCCeEEecc-cCc-----ce-eeeee
Q 014195 331 HIEFAWVLVNNSIVIVGGTTEKHPT-----------TKKMVLVGEI--FQFNLNTLKWHVIGK-LPY-----RV-KTTLA 390 (429)
Q Consensus 331 ~~~~~~~~~~~~i~v~GG~~~~~~~-----------~~~~~~~~~i--~~yd~~~~~W~~v~~-lp~-----~r-~~~~~ 390 (429)
+...-.+..++.||+||-+...++- +-..+|...+ --+.++.-+|..+.+ +-+ .- .-.++
T Consensus 240 htnlPFakvgD~l~mFgsERA~~EWE~G~~D~RY~~~yPRtF~~k~nv~~W~~d~~ew~nitdqIYqG~ivNSavGVGSv 319 (367)
T PF12217_consen 240 HTNLPFAKVGDVLYMFGSERAENEWEGGEPDNRYRANYPRTFMLKVNVSDWSLDDVEWVNITDQIYQGGIVNSAVGVGSV 319 (367)
T ss_dssp SS---EEEETTEEEEEEE-SSTT-SSTT-----SS-B--EEEEEEEETTT---TT---EEEEE-BB--SSS---SEEEEE
T ss_pred ccCCCceeeCCEEEEEeccccccccccCCCcccccccCCceEEEEeecccCCccceEEEEeecceeccccccccccceeE
Confidence 2222347899999999976653331 0011111111 112556667777632 221 11 22455
Q ss_pred EEECCEE-EEEcccCC
Q 014195 391 GYWNGWL-YFTSGQRD 405 (429)
Q Consensus 391 ~~~~~~i-~v~GG~~~ 405 (429)
+..++.| |+|||.+-
T Consensus 320 ~~KD~~lyy~FGgED~ 335 (367)
T PF12217_consen 320 VVKDGWLYYIFGGEDF 335 (367)
T ss_dssp EEETTEEEEEEEEB-S
T ss_pred EEECCEEEEEecCccc
Confidence 6778876 46888765
No 75
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=92.89 E-value=6.5 Score=34.93 Aligned_cols=62 Identities=6% Similarity=0.014 Sum_probs=30.5
Q ss_pred CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 122 NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 122 ~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
+.++++|+.+ ..+.+||..+++-........ .. -..+... ++..+++++. ...+..||..+.
T Consensus 21 ~~~l~~~~~~------g~i~i~~~~~~~~~~~~~~~~--~~-i~~~~~~~~~~~l~~~~~--------~~~i~i~~~~~~ 83 (289)
T cd00200 21 GKLLATGSGD------GTIKVWDLETGELLRTLKGHT--GP-VRDVAASADGTYLASGSS--------DKTIRLWDLETG 83 (289)
T ss_pred CCEEEEeecC------cEEEEEEeeCCCcEEEEecCC--cc-eeEEEECCCCCEEEEEcC--------CCeEEEEEcCcc
Confidence 3566666643 247778877664221111111 11 1122332 3445666654 346778888775
No 76
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=91.85 E-value=13 Score=36.09 Aligned_cols=103 Identities=13% Similarity=0.086 Sum_probs=56.0
Q ss_pred ECCEEEEEeccCCCCceeeeEEEEECCCCcee-eCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCC
Q 014195 120 IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWG-GRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTE 198 (429)
Q Consensus 120 ~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~-~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~ 198 (429)
.+++++.+|+..+ .+.+||.++..-- .+..-..| -...-....++.++++|+-+. .+-.+|.+
T Consensus 78 ~DG~LlaaGD~sG------~V~vfD~k~r~iLR~~~ah~ap--v~~~~f~~~d~t~l~s~sDd~--------v~k~~d~s 141 (487)
T KOG0310|consen 78 SDGRLLAAGDESG------HVKVFDMKSRVILRQLYAHQAP--VHVTKFSPQDNTMLVSGSDDK--------VVKYWDLS 141 (487)
T ss_pred cCCeEEEccCCcC------cEEEeccccHHHHHHHhhccCc--eeEEEecccCCeEEEecCCCc--------eEEEEEcC
Confidence 3789999998654 3788995552221 11122221 122233456899999987432 23344555
Q ss_pred CCceE-eCCCCC-CCCCCceEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 199 TKKWQ-DLPPLP-VPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 199 t~~W~-~~~~~p-~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
+..-. .+..-. .-|+ -++...++.|++.||+++ .+..|+.
T Consensus 142 ~a~v~~~l~~htDYVR~-g~~~~~~~hivvtGsYDg-----~vrl~Dt 183 (487)
T KOG0310|consen 142 TAYVQAELSGHTDYVRC-GDISPANDHIVVTGSYDG-----KVRLWDT 183 (487)
T ss_pred CcEEEEEecCCcceeEe-eccccCCCeEEEecCCCc-----eEEEEEe
Confidence 54421 111111 1122 234456788999999774 5777874
No 77
>PRK04792 tolB translocation protein TolB; Provisional
Probab=91.59 E-value=16 Score=36.38 Aligned_cols=62 Identities=15% Similarity=0.243 Sum_probs=39.8
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP 207 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~ 207 (429)
..++++|+.+++-+.+...+. ........-.+.+|++....++ ..+++.+|..+++.+.+..
T Consensus 242 ~~L~~~dl~tg~~~~lt~~~g--~~~~~~wSPDG~~La~~~~~~g------~~~Iy~~dl~tg~~~~lt~ 303 (448)
T PRK04792 242 AEIFVQDIYTQVREKVTSFPG--INGAPRFSPDGKKLALVLSKDG------QPEIYVVDIATKALTRITR 303 (448)
T ss_pred cEEEEEECCCCCeEEecCCCC--CcCCeeECCCCCEEEEEEeCCC------CeEEEEEECCCCCeEECcc
Confidence 359999999888777765543 1122233334556666543221 4689999999998888764
No 78
>PF02191 OLF: Olfactomedin-like domain; InterPro: IPR003112 The olfactomedin-domain was first identified in olfactomedin, an extracellular matrix protein of the olfactory neuroepithelium []. Members of this extracellular domain-family have since been shown to be present in several metazoan proteins, such as latrophilins, myocilins, optimedins and noelins, the latter being involved in the generation of neural crest cells. Myocilin is of considerable interest, as mutations in its olfactomedin-domain can lead to glaucoma []. The olfactomedin-domains in myocilin and optimedin are essential for the interaction between these two proteins [].; GO: 0005515 protein binding
Probab=91.49 E-value=7.8 Score=35.03 Aligned_cols=141 Identities=18% Similarity=0.235 Sum_probs=78.7
Q ss_pred CCEEEEEeccCCCCceeeeEEEEEC-----CCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEE
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNF-----TDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVL 195 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~-----~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~y 195 (429)
.+++|++.+..+. .++.|.- ..++....-.+|. +-.+.+.++.++.+|.--. ..+.+.+|
T Consensus 30 ~~~iy~~~~~~~~-----~v~ey~~~~~f~~~~~~~~~~~Lp~--~~~GtG~vVYngslYY~~~--------~s~~Ivky 94 (250)
T PF02191_consen 30 SEKIYVTSGFSGN-----TVYEYRNYEDFLRNGRSSRTYKLPY--PWQGTGHVVYNGSLYYNKY--------NSRNIVKY 94 (250)
T ss_pred CCCEEEECccCCC-----EEEEEcCHhHHhhcCCCceEEEEec--eeccCCeEEECCcEEEEec--------CCceEEEE
Confidence 5679999887654 2444432 2333333334554 4556777888998886522 27899999
Q ss_pred eCCCCceEeCCCCCCCCC---------C---ceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcc----ccceeec
Q 014195 196 DTETKKWQDLPPLPVPRY---------A---PATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPL----EKEWRTE 259 (429)
Q Consensus 196 d~~t~~W~~~~~~p~~r~---------~---~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~----~~~W~~~ 259 (429)
|+.+++-..-..+|.+.. . .-.++-++-|+|+-....... ++.+...||. ..+|...
T Consensus 95 dL~t~~v~~~~~L~~A~~~n~~~y~~~~~t~iD~AvDE~GLWvIYat~~~~g-------~ivvskld~~tL~v~~tw~T~ 167 (250)
T PF02191_consen 95 DLTTRSVVARRELPGAGYNNRFPYYWSGYTDIDFAVDENGLWVIYATEDNNG-------NIVVSKLDPETLSVEQTWNTS 167 (250)
T ss_pred ECcCCcEEEEEECCccccccccceecCCCceEEEEEcCCCEEEEEecCCCCC-------cEEEEeeCcccCceEEEEEec
Confidence 999987552222222211 1 223344566787755443211 1222222332 5678764
Q ss_pred cCCCCCCCceeEEEeCCEEEEEcccCC
Q 014195 260 IPIPRGGPHRACVVVDDRLLVIGGQEG 286 (429)
Q Consensus 260 ~~~p~~~~~~~~~~~~~~iyv~GG~~~ 286 (429)
.++...+ .+.++=|.||++-..+.
T Consensus 168 --~~k~~~~-naFmvCGvLY~~~s~~~ 191 (250)
T PF02191_consen 168 --YPKRSAG-NAFMVCGVLYATDSYDT 191 (250)
T ss_pred --cCchhhc-ceeeEeeEEEEEEECCC
Confidence 3433332 56677788999887653
No 79
>PF08268 FBA_3: F-box associated domain; InterPro: IPR013187 This domain occurs in a diverse superfamily of genes in plants. Most examples are found C-terminal to an F-box (IPR001810 from INTERPRO), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes []. Some members have two copies of this domain.
Probab=91.42 E-value=1.8 Score=34.56 Aligned_cols=82 Identities=12% Similarity=0.243 Sum_probs=57.3
Q ss_pred EeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC---CCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEee
Q 014195 169 TDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP---LPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLA 245 (429)
Q Consensus 169 ~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~---~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~ 245 (429)
.++|.+|-..-. ... ....+.+||..+.+|+.+.. .........++.++|+|-++.-..... ....+.|.+.
T Consensus 3 cinGvly~~a~~-~~~---~~~~IvsFDv~~E~f~~i~~P~~~~~~~~~~~L~~~~G~L~~v~~~~~~~-~~~~~iWvLe 77 (129)
T PF08268_consen 3 CINGVLYWLAWS-EDS---DNNVIVSFDVRSEKFRFIKLPEDPYSSDCSSTLIEYKGKLALVSYNDQGE-PDSIDIWVLE 77 (129)
T ss_pred EECcEEEeEEEE-CCC---CCcEEEEEEcCCceEEEEEeeeeeccccCccEEEEeCCeEEEEEecCCCC-cceEEEEEee
Confidence 357777766554 111 25789999999999998853 335567778889999999886544222 3457888876
Q ss_pred eecCCccccceeec
Q 014195 246 VKDGKPLEKEWRTE 259 (429)
Q Consensus 246 ~~~~d~~~~~W~~~ 259 (429)
|..++.|.+.
T Consensus 78 ----D~~k~~Wsk~ 87 (129)
T PF08268_consen 78 ----DYEKQEWSKK 87 (129)
T ss_pred ----ccccceEEEE
Confidence 5567889874
No 80
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=91.11 E-value=4.2 Score=36.71 Aligned_cols=139 Identities=12% Similarity=0.114 Sum_probs=79.9
Q ss_pred eeecCCCCe-EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccCCCCC-ccCCcE--EEECCEEEEE
Q 014195 52 SNWSPYHNS-IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKAAPVP-RLDGAA--IQIKNLLYVF 127 (429)
Q Consensus 52 ~~yd~~~~~-~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~-R~~~~~--~~~~~~iyv~ 127 (429)
-++||.++. ...|.+......|++...+...--..+..+.+...|+....=+.++. |.+ ..+..- ..-.+.+++.
T Consensus 171 GrLdPa~~~i~vfpaPqG~gpyGi~atpdGsvwyaslagnaiaridp~~~~aev~p~-P~~~~~gsRriwsdpig~~wit 249 (353)
T COG4257 171 GRLDPARNVISVFPAPQGGGPYGICATPDGSVWYASLAGNAIARIDPFAGHAEVVPQ-PNALKAGSRRIWSDPIGRAWIT 249 (353)
T ss_pred eecCcccCceeeeccCCCCCCcceEECCCCcEEEEeccccceEEcccccCCcceecC-CCcccccccccccCccCcEEEe
Confidence 488999988 33333333334566666555443344455666777777764333322 222 111111 1124567775
Q ss_pred eccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC
Q 014195 128 AGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP 206 (429)
Q Consensus 128 GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~ 206 (429)
......+.+|||.+.+|..- ++|..-+|....-+-..+++++- + -..+.+.+||+++.+.+.++
T Consensus 250 ------twg~g~l~rfdPs~~sW~ey-pLPgs~arpys~rVD~~grVW~s-----e---a~agai~rfdpeta~ftv~p 313 (353)
T COG4257 250 ------TWGTGSLHRFDPSVTSWIEY-PLPGSKARPYSMRVDRHGRVWLS-----E---ADAGAIGRFDPETARFTVLP 313 (353)
T ss_pred ------ccCCceeeEeCcccccceee-eCCCCCCCcceeeeccCCcEEee-----c---cccCceeecCcccceEEEec
Confidence 11123589999999999875 34443345555555556777763 1 11567889999999988764
No 81
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=90.67 E-value=10 Score=36.87 Aligned_cols=175 Identities=16% Similarity=0.214 Sum_probs=85.9
Q ss_pred ECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCC--CCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeC
Q 014195 120 IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPR--EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDT 197 (429)
Q Consensus 120 ~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~--~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~ 197 (429)
.++.+++.|+.+.- +..+|..+.. .+ ..+.. -.-| ..++...++.|++.||+++ .+-.||.
T Consensus 121 ~d~t~l~s~sDd~v------~k~~d~s~a~-v~-~~l~~htDYVR-~g~~~~~~~hivvtGsYDg--------~vrl~Dt 183 (487)
T KOG0310|consen 121 QDNTMLVSGSDDKV------VKYWDLSTAY-VQ-AELSGHTDYVR-CGDISPANDHIVVTGSYDG--------KVRLWDT 183 (487)
T ss_pred cCCeEEEecCCCce------EEEEEcCCcE-EE-EEecCCcceeE-eeccccCCCeEEEecCCCc--------eEEEEEe
Confidence 47889998875431 3445554444 22 12221 0012 2234445788999999876 3445666
Q ss_pred CCCceEeCCCCCCCCCCceEEEE--CCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCC-CCCCceeEEEe
Q 014195 198 ETKKWQDLPPLPVPRYAPATQLW--RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIP-RGGPHRACVVV 274 (429)
Q Consensus 198 ~t~~W~~~~~~p~~r~~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p-~~~~~~~~~~~ 274 (429)
.+.+ ..+..+....---.++.+ +..|...|| +++.+|++. ... +.+..+. .-.. -+|..+
T Consensus 184 R~~~-~~v~elnhg~pVe~vl~lpsgs~iasAgG-------n~vkVWDl~-----~G~---qll~~~~~H~Kt-VTcL~l 246 (487)
T KOG0310|consen 184 RSLT-SRVVELNHGCPVESVLALPSGSLIASAGG-------NSVKVWDLT-----TGG---QLLTSMFNHNKT-VTCLRL 246 (487)
T ss_pred ccCC-ceeEEecCCCceeeEEEcCCCCEEEEcCC-------CeEEEEEec-----CCc---eehhhhhcccce-EEEEEe
Confidence 6653 222222211111122222 344555566 568899864 000 1111111 1111 122112
Q ss_pred --CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeCCCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCC
Q 014195 275 --DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLDDEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEK 352 (429)
Q Consensus 275 --~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~ 352 (429)
++.=++-||.++. |-.|| ...|..+-.+..|-.-.+++ +..++.-.++|..++-
T Consensus 247 ~s~~~rLlS~sLD~~----------------------VKVfd-~t~~Kvv~s~~~~~pvLsia-vs~dd~t~viGmsnGl 302 (487)
T KOG0310|consen 247 ASDSTRLLSGSLDRH----------------------VKVFD-TTNYKVVHSWKYPGPVLSIA-VSPDDQTVVIGMSNGL 302 (487)
T ss_pred ecCCceEeecccccc----------------------eEEEE-ccceEEEEeeecccceeeEE-ecCCCceEEEecccce
Confidence 4466677776543 55553 45566665543333333443 5557888888987653
No 82
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=89.34 E-value=26 Score=35.28 Aligned_cols=114 Identities=15% Similarity=0.173 Sum_probs=56.5
Q ss_pred HHhhcceeeeecCCCcccceeeeeeecCCCCe--EEecCCCC--CC-----Ccceeeee-cC-CCCcCcccccccccccc
Q 014195 29 FALVADFFWASSSKFTSSYLNIASNWSPYHNS--IILPNNGP--QK-----GENIGVKT-KK-DVVPKRILPATFQDLPA 97 (429)
Q Consensus 29 ~~~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~--~~~p~~~~--r~-----~~~~~~~~-~~-~~~~~~~~~~~~~~~d~ 97 (429)
-++.++.+|+... + ..+..+|.++.+ .......+ +. ..++.... +. +... ....+..+|.
T Consensus 57 Pvv~~g~vy~~~~-~-----g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~~~~~V~v~~---~~g~v~AlD~ 127 (488)
T cd00216 57 PLVVDGDMYFTTS-H-----SALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYWDPRKVFFGT---FDGRLVALDA 127 (488)
T ss_pred CEEECCEEEEeCC-C-----CcEEEEECCCChhhceeCCCCCccccccccccCCcEEccCCeEEEec---CCCeEEEEEC
Confidence 3567888888543 2 367888998887 33322111 11 11111111 11 1111 2345677787
Q ss_pred cCC--CeEEccCCCC-C--ccCCcEEEECCEEEEEeccCCCC---ceeeeEEEEECCCCc--eee
Q 014195 98 PEL--KWEKMKAAPV-P--RLDGAAIQIKNLLYVFAGYGSID---YVHSHVDIYNFTDNT--WGG 152 (429)
Q Consensus 98 ~~~--~W~~~~~~p~-~--R~~~~~~~~~~~iyv~GG~~~~~---~~~~~~~~yd~~~~~--W~~ 152 (429)
.+. .|+.-..-+. . ....+.++.++.+|+ |..+... .....++++|..+.+ |+.
T Consensus 128 ~TG~~~W~~~~~~~~~~~~~i~ssP~v~~~~v~v-g~~~~~~~~~~~~g~v~alD~~TG~~~W~~ 191 (488)
T cd00216 128 ETGKQVWKFGNNDQVPPGYTMTGAPTIVKKLVII-GSSGAEFFACGVRGALRAYDVETGKLLWRF 191 (488)
T ss_pred CCCCEeeeecCCCCcCcceEecCCCEEECCEEEE-eccccccccCCCCcEEEEEECCCCceeeEe
Confidence 755 5876432221 0 112334555666665 4322211 113468999998775 864
No 83
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=89.24 E-value=12 Score=33.47 Aligned_cols=170 Identities=12% Similarity=0.059 Sum_probs=83.0
Q ss_pred cceeeeecCCCcccceeeeeeecCCCCe-EEecCCCCCCCcceeee-ecC-CCCcCcccccccccccccCCCeEEccCCC
Q 014195 33 ADFFWASSSKFTSSYLNIASNWSPYHNS-IILPNNGPQKGENIGVK-TKK-DVVPKRILPATFQDLPAPELKWEKMKAAP 109 (429)
Q Consensus 33 ~~~ly~~GG~~~~~~~~~~~~yd~~~~~-~~~p~~~~r~~~~~~~~-~~~-~~~~~~~~~~~~~~~d~~~~~W~~~~~~p 109 (429)
++.||.+--.. ..+.++|+.+.. ..+.... ..|.... ... ...+. ...+..+|+.+++++.+...+
T Consensus 11 ~g~l~~~D~~~-----~~i~~~~~~~~~~~~~~~~~---~~G~~~~~~~g~l~v~~---~~~~~~~d~~~g~~~~~~~~~ 79 (246)
T PF08450_consen 11 DGRLYWVDIPG-----GRIYRVDPDTGEVEVIDLPG---PNGMAFDRPDGRLYVAD---SGGIAVVDPDTGKVTVLADLP 79 (246)
T ss_dssp TTEEEEEETTT-----TEEEEEETTTTEEEEEESSS---EEEEEEECTTSEEEEEE---TTCEEEEETTTTEEEEEEEEE
T ss_pred CCEEEEEEcCC-----CEEEEEECCCCeEEEEecCC---CceEEEEccCCEEEEEE---cCceEEEecCCCcEEEEeecc
Confidence 45566654322 378899999998 3332221 2222222 111 11111 122344588888888877663
Q ss_pred -----CCccCCcEEEECCEEEEEeccCCCCcee--eeEEEEECCCCceeeCC-CCCCCCccceeeEEEe--CCEEEEEeC
Q 014195 110 -----VPRLDGAAIQIKNLLYVFAGYGSIDYVH--SHVDIYNFTDNTWGGRF-DMPREMAHSHLGMVTD--GRYIYVVTG 179 (429)
Q Consensus 110 -----~~R~~~~~~~~~~~iyv~GG~~~~~~~~--~~~~~yd~~~~~W~~~~-~~~~~~~r~~~~~~~~--~~~lyv~GG 179 (429)
..|..-.++.-++.||+.--........ ..++++++. .+.+.+. .+.. ..++++. ++.||+.-
T Consensus 80 ~~~~~~~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~~~~~-----pNGi~~s~dg~~lyv~d- 152 (246)
T PF08450_consen 80 DGGVPFNRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTVVADGLGF-----PNGIAFSPDGKTLYVAD- 152 (246)
T ss_dssp TTCSCTEEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEEEEEEESS-----EEEEEEETTSSEEEEEE-
T ss_pred CCCcccCCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEEEecCccc-----ccceEECCcchheeecc-
Confidence 2222233333367888854322211111 569999998 6655543 2322 2233333 55788751
Q ss_pred eeCCCCCCCCceeEEEeCCCCc--eEeC---CCCCCCCC-CceEEE-ECCEEEEE
Q 014195 180 QYGPQCRGPTAHTFVLDTETKK--WQDL---PPLPVPRY-APATQL-WRGRLHVM 227 (429)
Q Consensus 180 ~~~~~~~~~~~~~~~yd~~t~~--W~~~---~~~p~~r~-~~~~~~-~~~~lyv~ 227 (429)
. ....+++|++.... +... ..++.... --.+++ -++.|||.
T Consensus 153 --s-----~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~vD~~G~l~va 200 (246)
T PF08450_consen 153 --S-----FNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAVDSDGNLWVA 200 (246)
T ss_dssp --T-----TTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEEBTTS-EEEE
T ss_pred --c-----ccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceEcCCCCEEEE
Confidence 1 14679999886433 3322 22232221 122333 36889987
No 84
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=88.90 E-value=9.6 Score=35.85 Aligned_cols=139 Identities=17% Similarity=0.149 Sum_probs=76.5
Q ss_pred CEEEEEeCeeCCCCC-CCC-ceeEEEeCCCC-----ceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 172 RYIYVVTGQYGPQCR-GPT-AHTFVLDTETK-----KWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 172 ~~lyv~GG~~~~~~~-~~~-~~~~~yd~~t~-----~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
...+++|-....... .+. ..+..|+.... +++.+.....+-.-.+++.++++|.+.-| .....|++
T Consensus 42 ~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~~~~~~g~V~ai~~~~~~lv~~~g-------~~l~v~~l 114 (321)
T PF03178_consen 42 KEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIHSTEVKGPVTAICSFNGRLVVAVG-------NKLYVYDL 114 (321)
T ss_dssp SEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEEEEEESS-EEEEEEETTEEEEEET-------TEEEEEEE
T ss_pred cCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEEEEeecCcceEhhhhCCEEEEeec-------CEEEEEEc
Confidence 467777754322211 112 57889998885 66666544444445677788999777666 23555554
Q ss_pred eeecCCcccc-ceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEc
Q 014195 245 AVKDGKPLEK-EWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVL 322 (429)
Q Consensus 245 ~~~~~d~~~~-~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~ 322 (429)
. .. ++...+.+.......++.+.++.|++---..+- .++.|+ ...+-..+
T Consensus 115 ~-------~~~~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv---------------------~~~~~~~~~~~l~~v 166 (321)
T PF03178_consen 115 D-------NSKTLLKKAFYDSPFYITSLSVFKNYILVGDAMKSV---------------------SLLRYDEENNKLILV 166 (321)
T ss_dssp E-------TTSSEEEEEEE-BSSSEEEEEEETTEEEEEESSSSE---------------------EEEEEETTTE-EEEE
T ss_pred c-------CcccchhhheecceEEEEEEeccccEEEEEEcccCE---------------------EEEEEEccCCEEEEE
Confidence 2 33 477666655444555777788877765444321 266777 45567777
Q ss_pred CCCCCCCCCcceeEEEE-CCEEEEEc
Q 014195 323 PSMPKPDSHIEFAWVLV-NNSIVIVG 347 (429)
Q Consensus 323 ~~~~~~r~~~~~~~~~~-~~~i~v~G 347 (429)
+.-..++.-. ++..+ ++..++++
T Consensus 167 a~d~~~~~v~--~~~~l~d~~~~i~~ 190 (321)
T PF03178_consen 167 ARDYQPRWVT--AAEFLVDEDTIIVG 190 (321)
T ss_dssp EEESS-BEEE--EEEEE-SSSEEEEE
T ss_pred EecCCCccEE--EEEEecCCcEEEEE
Confidence 6544444432 22344 55544444
No 85
>PLN00181 protein SPA1-RELATED; Provisional
Probab=88.82 E-value=35 Score=36.73 Aligned_cols=58 Identities=12% Similarity=0.094 Sum_probs=30.0
Q ss_pred CEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCC-CCCCceEEE--ECCEEEEEeCCCCCCCCccccceEe
Q 014195 172 RYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPV-PRYAPATQL--WRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 172 ~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~-~r~~~~~~~--~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
+..++.|+.+ ..+..||..+.+-.. .+.. ...-.+++. .++.+++.||.++ .+..|++
T Consensus 545 ~~~las~~~D--------g~v~lWd~~~~~~~~--~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg-----~v~iWd~ 605 (793)
T PLN00181 545 KSQVASSNFE--------GVVQVWDVARSQLVT--EMKEHEKRVWSIDYSSADPTLLASGSDDG-----SVKLWSI 605 (793)
T ss_pred CCEEEEEeCC--------CeEEEEECCCCeEEE--EecCCCCCEEEEEEcCCCCCEEEEEcCCC-----EEEEEEC
Confidence 4455566542 367778887654322 1111 111122222 2567888888663 4667764
No 86
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=88.57 E-value=33 Score=35.56 Aligned_cols=102 Identities=18% Similarity=0.163 Sum_probs=56.4
Q ss_pred cceeeEEEeC--CEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC-CCCCCCCCceEEEECCEEEEEeCCCCCCCCcc
Q 014195 162 HSHLGMVTDG--RYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQLWRGRLHVMGGSGENRYTPE 238 (429)
Q Consensus 162 r~~~~~~~~~--~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~ 238 (429)
|..++++.++ |.|.+.|+.+ .-++++++..|++-..+- .-..|..+-+. ...+.+.+-|-+ +.+
T Consensus 435 p~QfscvavD~sGelV~AG~~d-------~F~IfvWS~qTGqllDiLsGHEgPVs~l~f-~~~~~~LaS~SW-----DkT 501 (893)
T KOG0291|consen 435 PIQFSCVAVDPSGELVCAGAQD-------SFEIFVWSVQTGQLLDILSGHEGPVSGLSF-SPDGSLLASGSW-----DKT 501 (893)
T ss_pred ceeeeEEEEcCCCCEEEeeccc-------eEEEEEEEeecCeeeehhcCCCCcceeeEE-ccccCeEEeccc-----cce
Confidence 3345555555 7788888753 457888888888766542 22222322222 223445555544 467
Q ss_pred ccceEeeeecCCccccceeeccCC------------CCCCCceeEEEeCCEEEEEcccC
Q 014195 239 VDHWSLAVKDGKPLEKEWRTEIPI------------PRGGPHRACVVVDDRLLVIGGQE 285 (429)
Q Consensus 239 ~~~~~~~~~~~d~~~~~W~~~~~~------------p~~~~~~~~~~~~~~iyv~GG~~ 285 (429)
+..|++. ..|.++.++ |.+. ..+++.+++.|-++--..
T Consensus 502 VRiW~if--------~s~~~vEtl~i~sdvl~vsfrPdG~-elaVaTldgqItf~d~~~ 551 (893)
T KOG0291|consen 502 VRIWDIF--------SSSGTVETLEIRSDVLAVSFRPDGK-ELAVATLDGQITFFDIKE 551 (893)
T ss_pred EEEEEee--------ccCceeeeEeeccceeEEEEcCCCC-eEEEEEecceEEEEEhhh
Confidence 8888853 222222111 3333 457788888888876443
No 87
>PF02191 OLF: Olfactomedin-like domain; InterPro: IPR003112 The olfactomedin-domain was first identified in olfactomedin, an extracellular matrix protein of the olfactory neuroepithelium []. Members of this extracellular domain-family have since been shown to be present in several metazoan proteins, such as latrophilins, myocilins, optimedins and noelins, the latter being involved in the generation of neural crest cells. Myocilin is of considerable interest, as mutations in its olfactomedin-domain can lead to glaucoma []. The olfactomedin-domains in myocilin and optimedin are essential for the interaction between these two proteins [].; GO: 0005515 protein binding
Probab=88.56 E-value=18 Score=32.63 Aligned_cols=182 Identities=14% Similarity=0.079 Sum_probs=95.1
Q ss_pred hcceeeeecCCCcccceeeeeeec-C-CCCe----EEecCCCCCCCcceeeeecC-CCCcCcccccccccccccCCCeEE
Q 014195 32 VADFFWASSSKFTSSYLNIASNWS-P-YHNS----IILPNNGPQKGENIGVKTKK-DVVPKRILPATFQDLPAPELKWEK 104 (429)
Q Consensus 32 ~~~~ly~~GG~~~~~~~~~~~~yd-~-~~~~----~~~p~~~~r~~~~~~~~~~~-~~~~~~~~~~~~~~~d~~~~~W~~ 104 (429)
-.+++|++.+..+. .+.....+. . ..++ ..|| .+-.+.|..+..+. +..+. -+..+..||..++.-..
T Consensus 29 ~~~~iy~~~~~~~~-~v~ey~~~~~f~~~~~~~~~~~Lp--~~~~GtG~vVYngslYY~~~--~s~~IvkydL~t~~v~~ 103 (250)
T PF02191_consen 29 DSEKIYVTSGFSGN-TVYEYRNYEDFLRNGRSSRTYKLP--YPWQGTGHVVYNGSLYYNKY--NSRNIVKYDLTTRSVVA 103 (250)
T ss_pred CCCCEEEECccCCC-EEEEEcCHhHHhhcCCCceEEEEe--ceeccCCeEEECCcEEEEec--CCceEEEEECcCCcEEE
Confidence 46788999887654 222221111 1 1111 4444 23344555555554 22222 45677888988876442
Q ss_pred ccCCCCCccC------------CcEEEECCEEEEEeccCCCCceeeeEEEEECCCC----ceeeCCCCCCCCccceeeEE
Q 014195 105 MKAAPVPRLD------------GAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDN----TWGGRFDMPREMAHSHLGMV 168 (429)
Q Consensus 105 ~~~~p~~R~~------------~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~----~W~~~~~~~~~~~r~~~~~~ 168 (429)
-..+|.+... .-.++-.+-|+|+=.....+.-. -+-..||.+- +|.. ..+. +....+..
T Consensus 104 ~~~L~~A~~~n~~~y~~~~~t~iD~AvDE~GLWvIYat~~~~g~i-vvskld~~tL~v~~tw~T--~~~k--~~~~naFm 178 (250)
T PF02191_consen 104 RRELPGAGYNNRFPYYWSGYTDIDFAVDENGLWVIYATEDNNGNI-VVSKLDPETLSVEQTWNT--SYPK--RSAGNAFM 178 (250)
T ss_pred EEECCccccccccceecCCCceEEEEEcCCCEEEEEecCCCCCcE-EEEeeCcccCceEEEEEe--ccCc--hhhcceee
Confidence 2333332211 22344456777776654433111 2556676644 5654 3443 33333333
Q ss_pred EeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC-CCCCCCCCceEEEE---CCEEEEEe
Q 014195 169 TDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQLW---RGRLHVMG 228 (429)
Q Consensus 169 ~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~~~---~~~lyv~G 228 (429)
+ =|.||++--.+... ..-.+.||..+++=..+. +++.+-..++++.+ +.+||+.-
T Consensus 179 v-CGvLY~~~s~~~~~----~~I~yafDt~t~~~~~~~i~f~~~~~~~~~l~YNP~dk~LY~wd 237 (250)
T PF02191_consen 179 V-CGVLYATDSYDTRD----TEIFYAFDTYTGKEEDVSIPFPNPYGNISMLSYNPRDKKLYAWD 237 (250)
T ss_pred E-eeEEEEEEECCCCC----cEEEEEEECCCCceeceeeeeccccCceEeeeECCCCCeEEEEE
Confidence 3 45689885543322 456688999988766543 34444455566655 57899883
No 88
>PRK05137 tolB translocation protein TolB; Provisional
Probab=88.45 E-value=27 Score=34.44 Aligned_cols=191 Identities=10% Similarity=0.028 Sum_probs=86.9
Q ss_pred eeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCce
Q 014195 137 HSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPA 216 (429)
Q Consensus 137 ~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~ 216 (429)
...+++.|.....=+.+..-.. .-......-.+.+|+.+. ... . ...++.+|+.+.+.+.+...+......
T Consensus 181 ~~~l~~~d~dg~~~~~lt~~~~--~v~~p~wSpDG~~lay~s-~~~-g----~~~i~~~dl~~g~~~~l~~~~g~~~~~- 251 (435)
T PRK05137 181 IKRLAIMDQDGANVRYLTDGSS--LVLTPRFSPNRQEITYMS-YAN-G----RPRVYLLDLETGQRELVGNFPGMTFAP- 251 (435)
T ss_pred ceEEEEECCCCCCcEEEecCCC--CeEeeEECCCCCEEEEEE-ecC-C----CCEEEEEECCCCcEEEeecCCCcccCc-
Confidence 3468888876544333432221 111222223344554442 111 1 368999999999888776544322222
Q ss_pred EEEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCC
Q 014195 217 TQLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSP 295 (429)
Q Consensus 217 ~~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~ 295 (429)
...-++ +|++....++ ..+.|.++ ..+..-+.+...+.... .....-+++-++|......
T Consensus 252 ~~SPDG~~la~~~~~~g-----~~~Iy~~d-----~~~~~~~~Lt~~~~~~~-~~~~spDG~~i~f~s~~~g-------- 312 (435)
T PRK05137 252 RFSPDGRKVVMSLSQGG-----NTDIYTMD-----LRSGTTTRLTDSPAIDT-SPSYSPDGSQIVFESDRSG-------- 312 (435)
T ss_pred EECCCCCEEEEEEecCC-----CceEEEEE-----CCCCceEEccCCCCccC-ceeEcCCCCEEEEEECCCC--------
Confidence 222344 4444432221 23344332 44444444433221111 1222334543333321111
Q ss_pred ccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 296 IFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 296 ~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
...+|.+| .....+.+.... ...... ....+++.+++....... ..++.+|+++..
T Consensus 313 -----------~~~Iy~~d~~g~~~~~lt~~~--~~~~~~-~~SpdG~~ia~~~~~~~~---------~~i~~~d~~~~~ 369 (435)
T PRK05137 313 -----------SPQLYVMNADGSNPRRISFGG--GRYSTP-VWSPRGDLIAFTKQGGGQ---------FSIGVMKPDGSG 369 (435)
T ss_pred -----------CCeEEEEECCCCCeEEeecCC--CcccCe-EECCCCCEEEEEEcCCCc---------eEEEEEECCCCc
Confidence 12488888 666666654321 111111 234556555444332221 268899987766
Q ss_pred eEEe
Q 014195 375 WHVI 378 (429)
Q Consensus 375 W~~v 378 (429)
.+.+
T Consensus 370 ~~~l 373 (435)
T PRK05137 370 ERIL 373 (435)
T ss_pred eEec
Confidence 6555
No 89
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=88.11 E-value=27 Score=34.01 Aligned_cols=62 Identities=15% Similarity=0.259 Sum_probs=38.0
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP 207 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~ 207 (429)
..++++|..+++-..+...+. ........-.+..|++....++ ..+++.+|+.+...+.+..
T Consensus 214 ~~i~v~d~~~g~~~~~~~~~~--~~~~~~~spDg~~l~~~~~~~~------~~~i~~~d~~~~~~~~l~~ 275 (417)
T TIGR02800 214 PEIYVQDLATGQREKVASFPG--MNGAPAFSPDGSKLAVSLSKDG------NPDIYVMDLDGKQLTRLTN 275 (417)
T ss_pred cEEEEEECCCCCEEEeecCCC--CccceEECCCCCEEEEEECCCC------CccEEEEECCCCCEEECCC
Confidence 458999999887776655433 1222222223445665533221 4579999999988877754
No 90
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=87.68 E-value=2.3 Score=38.44 Aligned_cols=111 Identities=14% Similarity=0.137 Sum_probs=73.3
Q ss_pred cceeeeecC--CCCcCcccccccccccccCCCeEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc
Q 014195 72 ENIGVKTKK--DVVPKRILPATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT 149 (429)
Q Consensus 72 ~~~~~~~~~--~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~ 149 (429)
-|+....+. +...+.+-.+.+..+|+.+++-....++|..-++=+++.++++||..-=. ....++||+.+
T Consensus 48 QGL~~~~~g~LyESTG~yG~S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~~d~l~qLTWk------~~~~f~yd~~t-- 119 (264)
T PF05096_consen 48 QGLEFLDDGTLYESTGLYGQSSLRKVDLETGKVLQSVPLPPRYFGEGITILGDKLYQLTWK------EGTGFVYDPNT-- 119 (264)
T ss_dssp EEEEEEETTEEEEEECSTTEEEEEEEETTTSSEEEEEE-TTT--EEEEEEETTEEEEEESS------SSEEEEEETTT--
T ss_pred ccEEecCCCEEEEeCCCCCcEEEEEEECCCCcEEEEEECCccccceeEEEECCEEEEEEec------CCeEEEEcccc--
Confidence 355553332 44555555667788999998877777788777778889999999997421 23478999975
Q ss_pred eeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc
Q 014195 150 WGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK 201 (429)
Q Consensus 150 W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~ 201 (429)
.+.+...+. +..+.+++..+..|++.-| ++.++..||++-+
T Consensus 120 l~~~~~~~y--~~EGWGLt~dg~~Li~SDG---------S~~L~~~dP~~f~ 160 (264)
T PF05096_consen 120 LKKIGTFPY--PGEGWGLTSDGKRLIMSDG---------SSRLYFLDPETFK 160 (264)
T ss_dssp TEEEEEEE---SSS--EEEECSSCEEEE-S---------SSEEEEE-TTT-S
T ss_pred ceEEEEEec--CCcceEEEcCCCEEEEECC---------ccceEEECCcccc
Confidence 455555544 3568889988888888755 6789999998754
No 91
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=87.11 E-value=26 Score=32.69 Aligned_cols=238 Identities=13% Similarity=0.124 Sum_probs=97.4
Q ss_pred cCCCeEEccCC-CCC-cc-CCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeE-EEeCCE
Q 014195 98 PELKWEKMKAA-PVP-RL-DGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGM-VTDGRY 173 (429)
Q Consensus 98 ~~~~W~~~~~~-p~~-R~-~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~-~~~~~~ 173 (429)
-..+|+.+..- +.+ .. ..++...++..||+|-. . -+..-.-.-.+|++++ ++.+.+...+.+ +..++.
T Consensus 45 GG~tW~~~~~~~~~~~~~~l~~I~f~~~~g~ivG~~---g----~ll~T~DgG~tW~~v~-l~~~lpgs~~~i~~l~~~~ 116 (302)
T PF14870_consen 45 GGKTWQPVSLDLDNPFDYHLNSISFDGNEGWIVGEP---G----LLLHTTDGGKTWERVP-LSSKLPGSPFGITALGDGS 116 (302)
T ss_dssp TTSS-EE-----S-----EEEEEEEETTEEEEEEET---T----EEEEESSTTSS-EE-----TT-SS-EEEEEEEETTE
T ss_pred CCccccccccCCCccceeeEEEEEecCCceEEEcCC---c----eEEEecCCCCCcEEee-cCCCCCCCeeEEEEcCCCc
Confidence 45689887632 222 22 22334457888988731 1 1333344567899985 221122233333 344667
Q ss_pred EEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEE-EECCEEEEEeCCCCCCCCccccceEeeeecCCcc
Q 014195 174 IYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQ-LWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPL 252 (429)
Q Consensus 174 lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~-~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~ 252 (429)
++++|. ...+++=.-.-.+|+.+..-.. -....+. .-++++++++-.. .- ...| |+.
T Consensus 117 ~~l~~~---------~G~iy~T~DgG~tW~~~~~~~~-gs~~~~~r~~dG~~vavs~~G-~~----~~s~-------~~G 174 (302)
T PF14870_consen 117 AELAGD---------RGAIYRTTDGGKTWQAVVSETS-GSINDITRSSDGRYVAVSSRG-NF----YSSW-------DPG 174 (302)
T ss_dssp EEEEET---------T--EEEESSTTSSEEEEE-S-----EEEEEE-TTS-EEEEETTS-SE----EEEE--------TT
T ss_pred EEEEcC---------CCcEEEeCCCCCCeeEcccCCc-ceeEeEEECCCCcEEEEECcc-cE----EEEe-------cCC
Confidence 777753 3356655556678998753222 1112222 2356666665332 21 1122 266
Q ss_pred ccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC---CCCCeEEcCCCCCCC
Q 014195 253 EKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD---DEMKWKVLPSMPKPD 329 (429)
Q Consensus 253 ~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d---~~~~W~~~~~~~~~r 329 (429)
...|+........+.......-++.|+++. ..+. ++.-+ ....|.+.. .|...
T Consensus 175 ~~~w~~~~r~~~~riq~~gf~~~~~lw~~~-~Gg~----------------------~~~s~~~~~~~~w~~~~-~~~~~ 230 (302)
T PF14870_consen 175 QTTWQPHNRNSSRRIQSMGFSPDGNLWMLA-RGGQ----------------------IQFSDDPDDGETWSEPI-IPIKT 230 (302)
T ss_dssp -SS-EEEE--SSS-EEEEEE-TTS-EEEEE-TTTE----------------------EEEEE-TTEEEEE---B--TTSS
T ss_pred CccceEEccCccceehhceecCCCCEEEEe-CCcE----------------------EEEccCCCCcccccccc-CCccc
Confidence 667887544333333333344567787765 2111 22221 456777733 23222
Q ss_pred CCcc-eeEE-EECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEeccc-Ccceeeeee-EEECCEEEEEcc
Q 014195 330 SHIE-FAWV-LVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKL-PYRVKTTLA-GYWNGWLYFTSG 402 (429)
Q Consensus 330 ~~~~-~~~~-~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~l-p~~r~~~~~-~~~~~~i~v~GG 402 (429)
...+ ..++ ..++.+++.||.. .+++=.-..++|++.... +.+-..+.+ ..-+++-+++|-
T Consensus 231 ~~~~~ld~a~~~~~~~wa~gg~G-------------~l~~S~DgGktW~~~~~~~~~~~n~~~i~f~~~~~gf~lG~ 294 (302)
T PF14870_consen 231 NGYGILDLAYRPPNEIWAVGGSG-------------TLLVSTDGGKTWQKDRVGENVPSNLYRIVFVNPDKGFVLGQ 294 (302)
T ss_dssp --S-EEEEEESSSS-EEEEESTT--------------EEEESSTTSS-EE-GGGTTSSS---EEEEEETTEEEEE-S
T ss_pred CceeeEEEEecCCCCEEEEeCCc-------------cEEEeCCCCccceECccccCCCCceEEEEEcCCCceEEECC
Confidence 2222 2222 3357999999863 344333356799987432 223222222 235578888864
No 92
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=86.49 E-value=10 Score=34.36 Aligned_cols=96 Identities=20% Similarity=0.182 Sum_probs=67.0
Q ss_pred ECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 120 IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 120 ~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
.++.+|.--|.-+. +.+..||+.+++-....++|. .-.+=+++..+++||..-= .....++||+.+
T Consensus 54 ~~g~LyESTG~yG~----S~l~~~d~~tg~~~~~~~l~~--~~FgEGit~~~d~l~qLTW--------k~~~~f~yd~~t 119 (264)
T PF05096_consen 54 DDGTLYESTGLYGQ----SSLRKVDLETGKVLQSVPLPP--RYFGEGITILGDKLYQLTW--------KEGTGFVYDPNT 119 (264)
T ss_dssp ETTEEEEEECSTTE----EEEEEEETTTSSEEEEEE-TT--T--EEEEEEETTEEEEEES--------SSSEEEEEETTT
T ss_pred CCCEEEEeCCCCCc----EEEEEEECCCCcEEEEEECCc--cccceeEEEECCEEEEEEe--------cCCeEEEEcccc
Confidence 47899998887653 468899999998776667776 5667788999999999831 145788999976
Q ss_pred CceEeCCCCCCCCCCceEEEECCEEEEEeCCC
Q 014195 200 KKWQDLPPLPVPRYAPATQLWRGRLHVMGGSG 231 (429)
Q Consensus 200 ~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~ 231 (429)
.+.+...+.+.-+-.++.-+..|++--|.+
T Consensus 120 --l~~~~~~~y~~EGWGLt~dg~~Li~SDGS~ 149 (264)
T PF05096_consen 120 --LKKIGTFPYPGEGWGLTSDGKRLIMSDGSS 149 (264)
T ss_dssp --TEEEEEEE-SSS--EEEECSSCEEEE-SSS
T ss_pred --ceEEEEEecCCcceEEEcCCCEEEEECCcc
Confidence 455555555667778887778888887743
No 93
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=86.46 E-value=29 Score=32.61 Aligned_cols=90 Identities=13% Similarity=0.126 Sum_probs=44.6
Q ss_pred EEEEEeccCCCCceeeeEEEEECCC-CceeeCCCCCCCCccceeeEEE--eCCEEEEEeCeeCCCCCCCCceeEEEeCC-
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTD-NTWGGRFDMPREMAHSHLGMVT--DGRYIYVVTGQYGPQCRGPTAHTFVLDTE- 198 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~-~~W~~~~~~~~~~~r~~~~~~~--~~~~lyv~GG~~~~~~~~~~~~~~~yd~~- 198 (429)
++|+..+.+ ..+.+||..+ .+++.+..++.. ...+.+++ .+..||+.+.. ...+..|+..
T Consensus 3 ~~y~~~~~~------~~I~~~~~~~~g~l~~~~~~~~~--~~~~~l~~spd~~~lyv~~~~--------~~~i~~~~~~~ 66 (330)
T PRK11028 3 IVYIASPES------QQIHVWNLNHEGALTLLQVVDVP--GQVQPMVISPDKRHLYVGVRP--------EFRVLSYRIAD 66 (330)
T ss_pred EEEEEcCCC------CCEEEEEECCCCceeeeeEEecC--CCCccEEECCCCCEEEEEECC--------CCcEEEEEECC
Confidence 578875443 2367777754 567665544431 11222333 35567775431 2456566665
Q ss_pred CCceEeCCCCCCCCCCceEEEE-CC-EEEEEe
Q 014195 199 TKKWQDLPPLPVPRYAPATQLW-RG-RLHVMG 228 (429)
Q Consensus 199 t~~W~~~~~~p~~r~~~~~~~~-~~-~lyv~G 228 (429)
+.+++.+...+.+..-+.++.. ++ .||+..
T Consensus 67 ~g~l~~~~~~~~~~~p~~i~~~~~g~~l~v~~ 98 (330)
T PRK11028 67 DGALTFAAESPLPGSPTHISTDHQGRFLFSAS 98 (330)
T ss_pred CCceEEeeeecCCCCceEEEECCCCCEEEEEE
Confidence 4567665543333222223322 34 466654
No 94
>PRK04792 tolB translocation protein TolB; Provisional
Probab=85.97 E-value=39 Score=33.58 Aligned_cols=190 Identities=15% Similarity=0.097 Sum_probs=90.9
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
..+++.|.....-..+...+. +-......-.+.+|+.+- .. .. ...++.+|+.+.+-+.+...+...... .
T Consensus 198 ~~l~i~d~dG~~~~~l~~~~~--~~~~p~wSPDG~~La~~s-~~-~g----~~~L~~~dl~tg~~~~lt~~~g~~~~~-~ 268 (448)
T PRK04792 198 YQLMIADYDGYNEQMLLRSPE--PLMSPAWSPDGRKLAYVS-FE-NR----KAEIFVQDIYTQVREKVTSFPGINGAP-R 268 (448)
T ss_pred eEEEEEeCCCCCceEeecCCC--cccCceECCCCCEEEEEE-ec-CC----CcEEEEEECCCCCeEEecCCCCCcCCe-e
Confidence 457778876655454433332 111222222344454432 11 11 468999999988877766544221211 2
Q ss_pred EEEC-CEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCE-EEEEcccCCCCCCCCCCC
Q 014195 218 QLWR-GRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDR-LLVIGGQEGDFMAKPGSP 295 (429)
Q Consensus 218 ~~~~-~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~-iyv~GG~~~~~~~~~~~~ 295 (429)
..-+ .+|++....++ ..+.|.+ |..+.+.+.+........ ......+++ |++.....+
T Consensus 269 wSPDG~~La~~~~~~g-----~~~Iy~~-----dl~tg~~~~lt~~~~~~~-~p~wSpDG~~I~f~s~~~g--------- 328 (448)
T PRK04792 269 FSPDGKKLALVLSKDG-----QPEIYVV-----DIATKALTRITRHRAIDT-EPSWHPDGKSLIFTSERGG--------- 328 (448)
T ss_pred ECCCCCEEEEEEeCCC-----CeEEEEE-----ECCCCCeEECccCCCCcc-ceEECCCCCEEEEEECCCC---------
Confidence 2223 44655433221 1233433 355555555433221111 122233554 444332211
Q ss_pred ccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 296 IFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 296 ~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
...+|.+| .+.+++.+... ....... ....+++.+++....... ..++.+|+++..
T Consensus 329 -----------~~~Iy~~dl~~g~~~~Lt~~--g~~~~~~-~~SpDG~~l~~~~~~~g~---------~~I~~~dl~~g~ 385 (448)
T PRK04792 329 -----------KPQIYRVNLASGKVSRLTFE--GEQNLGG-SITPDGRSMIMVNRTNGK---------FNIARQDLETGA 385 (448)
T ss_pred -----------CceEEEEECCCCCEEEEecC--CCCCcCe-eECCCCCEEEEEEecCCc---------eEEEEEECCCCC
Confidence 12588888 77888876421 1111112 244566555554433221 278999999888
Q ss_pred eEEec
Q 014195 375 WHVIG 379 (429)
Q Consensus 375 W~~v~ 379 (429)
.+.+.
T Consensus 386 ~~~lt 390 (448)
T PRK04792 386 MQVLT 390 (448)
T ss_pred eEEcc
Confidence 77664
No 95
>smart00284 OLF Olfactomedin-like domains.
Probab=85.78 E-value=27 Score=31.59 Aligned_cols=140 Identities=16% Similarity=0.173 Sum_probs=75.7
Q ss_pred CCEEEEEeccCCCCceeeeEEEEEC----CCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEe
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNF----TDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLD 196 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~----~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd 196 (429)
++++|++-+.... .+.++.|.. ....+.+.-.+|. +-.+.+.++.+|.+|.--. ....+.+||
T Consensus 34 ~~~~wv~~~~~~~---~~~v~ey~~~~~f~~~~~~~~~~Lp~--~~~GtG~VVYngslYY~~~--------~s~~iiKyd 100 (255)
T smart00284 34 KSLYWYMPLNTRV---LRSVREYSSMSDFQMGKNPTDHPLPH--AGQGTGVVVYNGSLYFNKF--------NSHDICRFD 100 (255)
T ss_pred CceEEEEccccCC---CcEEEEecCHHHHhccCCceEEECCC--ccccccEEEECceEEEEec--------CCccEEEEE
Confidence 4778998765421 233555543 2334433334555 5667788999999997422 157899999
Q ss_pred CCCCceEeCCCCCCCC----C-----C---ceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcc----ccceeecc
Q 014195 197 TETKKWQDLPPLPVPR----Y-----A---PATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPL----EKEWRTEI 260 (429)
Q Consensus 197 ~~t~~W~~~~~~p~~r----~-----~---~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~----~~~W~~~~ 260 (429)
+.+++-.....+|.+. . . .-.++-++-|+|+=......- .+.+...||. .++|...-
T Consensus 101 L~t~~v~~~~~Lp~a~y~~~~~Y~~~~~sdiDlAvDE~GLWvIYat~~~~g-------~ivvSkLnp~tL~ve~tW~T~~ 173 (255)
T smart00284 101 LTTETYQKEPLLNGAGYNNRFPYAWGGFSDIDLAVDENGLWVIYATEQNAG-------KIVISKLNPATLTIENTWITTY 173 (255)
T ss_pred CCCCcEEEEEecCccccccccccccCCCccEEEEEcCCceEEEEeccCCCC-------CEEEEeeCcccceEEEEEEcCC
Confidence 9998865444444321 1 1 122333455666643322110 1111222232 45788743
Q ss_pred CCCCCCCceeEEEeCCEEEEEcc
Q 014195 261 PIPRGGPHRACVVVDDRLLVIGG 283 (429)
Q Consensus 261 ~~p~~~~~~~~~~~~~~iyv~GG 283 (429)
+-+... .+.++=|.||++-.
T Consensus 174 ~k~sa~---naFmvCGvLY~~~s 193 (255)
T smart00284 174 NKRSAS---NAFMICGILYVTRS 193 (255)
T ss_pred Cccccc---ccEEEeeEEEEEcc
Confidence 333333 55666678999864
No 96
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=85.39 E-value=43 Score=33.65 Aligned_cols=107 Identities=11% Similarity=0.062 Sum_probs=54.1
Q ss_pred cccccccccCC--CeEEccCCCCCc-----cCCcEEEEC-CEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCC-
Q 014195 90 ATFQDLPAPEL--KWEKMKAAPVPR-----LDGAAIQIK-NLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPR- 158 (429)
Q Consensus 90 ~~~~~~d~~~~--~W~~~~~~p~~R-----~~~~~~~~~-~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~- 158 (429)
..++.+|..+. .|+.-...+..+ ....++..+ ++||+... ...+.++|.++.+ |+.-...+.
T Consensus 71 g~l~AlD~~tG~~~W~~~~~~~~~~~~~~~~~~g~~~~~~~~V~v~~~-------~g~v~AlD~~TG~~~W~~~~~~~~~ 143 (488)
T cd00216 71 SALFALDAATGKVLWRYDPKLPADRGCCDVVNRGVAYWDPRKVFFGTF-------DGRLVALDAETGKQVWKFGNNDQVP 143 (488)
T ss_pred CcEEEEECCCChhhceeCCCCCccccccccccCCcEEccCCeEEEecC-------CCeEEEEECCCCCEeeeecCCCCcC
Confidence 45667777654 587643222111 111234446 78887432 1358899998764 876432211
Q ss_pred CCccceeeEEEeCCEEEEEeCeeCCC-CCCCCceeEEEeCCCCc--eEe
Q 014195 159 EMAHSHLGMVTDGRYIYVVTGQYGPQ-CRGPTAHTFVLDTETKK--WQD 204 (429)
Q Consensus 159 ~~~r~~~~~~~~~~~lyv~GG~~~~~-~~~~~~~~~~yd~~t~~--W~~ 204 (429)
+......+.++.++.+|+ |...... .......++++|.+|.+ |+.
T Consensus 144 ~~~~i~ssP~v~~~~v~v-g~~~~~~~~~~~~g~v~alD~~TG~~~W~~ 191 (488)
T cd00216 144 PGYTMTGAPTIVKKLVII-GSSGAEFFACGVRGALRAYDVETGKLLWRF 191 (488)
T ss_pred cceEecCCCEEECCEEEE-eccccccccCCCCcEEEEEECCCCceeeEe
Confidence 000112334555676664 4322111 00114578999998764 875
No 97
>PRK05137 tolB translocation protein TolB; Provisional
Probab=85.33 E-value=40 Score=33.23 Aligned_cols=63 Identities=14% Similarity=0.159 Sum_probs=40.0
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCC
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPL 208 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~ 208 (429)
..++++|+.+++.+.+...+. ........-.+.+|++....++ ..+++.+|..+.+-..+...
T Consensus 226 ~~i~~~dl~~g~~~~l~~~~g--~~~~~~~SPDG~~la~~~~~~g------~~~Iy~~d~~~~~~~~Lt~~ 288 (435)
T PRK05137 226 PRVYLLDLETGQRELVGNFPG--MTFAPRFSPDGRKVVMSLSQGG------NTDIYTMDLRSGTTTRLTDS 288 (435)
T ss_pred CEEEEEECCCCcEEEeecCCC--cccCcEECCCCCEEEEEEecCC------CceEEEEECCCCceEEccCC
Confidence 359999999998888766554 1222223333455655433221 46899999999887777643
No 98
>PRK00178 tolB translocation protein TolB; Provisional
Probab=85.16 E-value=40 Score=33.09 Aligned_cols=183 Identities=14% Similarity=0.156 Sum_probs=89.2
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
..++++|+.+++-+.+...+.. -......-.+++|++..-.++ ..+++.+|..+.+.+.+..-+..-... .
T Consensus 223 ~~l~~~~l~~g~~~~l~~~~g~--~~~~~~SpDG~~la~~~~~~g------~~~Iy~~d~~~~~~~~lt~~~~~~~~~-~ 293 (430)
T PRK00178 223 PRIFVQNLDTGRREQITNFEGL--NGAPAWSPDGSKLAFVLSKDG------NPEIYVMDLASRQLSRVTNHPAIDTEP-F 293 (430)
T ss_pred CEEEEEECCCCCEEEccCCCCC--cCCeEECCCCCEEEEEEccCC------CceEEEEECCCCCeEEcccCCCCcCCe-E
Confidence 3599999999988877654431 111222223445654432111 358999999999988776432211111 1
Q ss_pred EEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCE-EEEEcccCCCCCCCCCCC
Q 014195 218 QLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDR-LLVIGGQEGDFMAKPGSP 295 (429)
Q Consensus 218 ~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~-iyv~GG~~~~~~~~~~~~ 295 (429)
..-++ +|++.....+ ..+.|.+ |..+.+++.+....... ......-+++ |++.....+.
T Consensus 294 ~spDg~~i~f~s~~~g-----~~~iy~~-----d~~~g~~~~lt~~~~~~-~~~~~Spdg~~i~~~~~~~~~-------- 354 (430)
T PRK00178 294 WGKDGRTLYFTSDRGG-----KPQIYKV-----NVNGGRAERVTFVGNYN-ARPRLSADGKTLVMVHRQDGN-------- 354 (430)
T ss_pred ECCCCCEEEEEECCCC-----CceEEEE-----ECCCCCEEEeecCCCCc-cceEECCCCCEEEEEEccCCc--------
Confidence 22244 4555432221 1233333 24455555543211111 1122223444 5444322111
Q ss_pred ccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC
Q 014195 296 IFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL 373 (429)
Q Consensus 296 ~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~ 373 (429)
..++.+| .+...+.+...... . .. ....+++.+++....... ..++..+.+.+
T Consensus 355 ------------~~l~~~dl~tg~~~~lt~~~~~-~--~p-~~spdg~~i~~~~~~~g~---------~~l~~~~~~g~ 408 (430)
T PRK00178 355 ------------FHVAAQDLQRGSVRILTDTSLD-E--SP-SVAPNGTMLIYATRQQGR---------GVLMLVSINGR 408 (430)
T ss_pred ------------eEEEEEECCCCCEEEccCCCCC-C--Cc-eECCCCCEEEEEEecCCc---------eEEEEEECCCC
Confidence 1478888 77777777643211 1 12 245577777766543322 25777776543
No 99
>PRK04922 tolB translocation protein TolB; Provisional
Probab=84.30 E-value=45 Score=32.90 Aligned_cols=183 Identities=12% Similarity=0.099 Sum_probs=89.2
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
..++++|..+++-+.+...+. ........-.+.+|++....++ ..+++.+|+.+.+-+.+..-...... ..
T Consensus 228 ~~l~~~dl~~g~~~~l~~~~g--~~~~~~~SpDG~~l~~~~s~~g------~~~Iy~~d~~~g~~~~lt~~~~~~~~-~~ 298 (433)
T PRK04922 228 SAIYVQDLATGQRELVASFRG--INGAPSFSPDGRRLALTLSRDG------NPEIYVMDLGSRQLTRLTNHFGIDTE-PT 298 (433)
T ss_pred cEEEEEECCCCCEEEeccCCC--CccCceECCCCCEEEEEEeCCC------CceEEEEECCCCCeEECccCCCCccc-eE
Confidence 358999999988877765543 1112222233456655432221 35899999999887766533211111 12
Q ss_pred EEECCE-EEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCC-EEEEEcccCCCCCCCCCCC
Q 014195 218 QLWRGR-LHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDD-RLLVIGGQEGDFMAKPGSP 295 (429)
Q Consensus 218 ~~~~~~-lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~-~iyv~GG~~~~~~~~~~~~ 295 (429)
..-+++ |+......+ ..+.|.+ |..+.+.+.+......... ....-++ .|++..+..+.
T Consensus 299 ~spDG~~l~f~sd~~g-----~~~iy~~-----dl~~g~~~~lt~~g~~~~~-~~~SpDG~~Ia~~~~~~~~-------- 359 (433)
T PRK04922 299 WAPDGKSIYFTSDRGG-----RPQIYRV-----AASGGSAERLTFQGNYNAR-ASVSPDGKKIAMVHGSGGQ-------- 359 (433)
T ss_pred ECCCCCEEEEEECCCC-----CceEEEE-----ECCCCCeEEeecCCCCccC-EEECCCCCEEEEEECCCCc--------
Confidence 223444 444332221 1233433 2444555544321111111 2222344 45554432211
Q ss_pred ccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC
Q 014195 296 IFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL 373 (429)
Q Consensus 296 ~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~ 373 (429)
..++.+| .+...+.+..-.. . ... ....+++.+++....... ..++.+|.+..
T Consensus 360 ------------~~I~v~d~~~g~~~~Lt~~~~--~-~~p-~~spdG~~i~~~s~~~g~---------~~L~~~~~~g~ 413 (433)
T PRK04922 360 ------------YRIAVMDLSTGSVRTLTPGSL--D-ESP-SFAPNGSMVLYATREGGR---------GVLAAVSTDGR 413 (433)
T ss_pred ------------eeEEEEECCCCCeEECCCCCC--C-CCc-eECCCCCEEEEEEecCCc---------eEEEEEECCCC
Confidence 1477777 6777776654221 1 112 245567666665543222 26888888654
No 100
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=84.17 E-value=39 Score=32.13 Aligned_cols=96 Identities=20% Similarity=0.126 Sum_probs=49.3
Q ss_pred EEeccCC-CCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEE--eCCCCce
Q 014195 126 VFAGYGS-IDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVL--DTETKKW 202 (429)
Q Consensus 126 v~GG~~~-~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~y--d~~t~~W 202 (429)
++|++.. ..... .++.||.++.+++.+........-...++.-.++.||+...... ....+..| +.++.+.
T Consensus 3 ~vgsy~~~~~~gI-~~~~~d~~~g~l~~~~~~~~~~~Ps~l~~~~~~~~LY~~~e~~~-----~~g~v~~~~i~~~~g~L 76 (345)
T PF10282_consen 3 YVGSYTNGKGGGI-YVFRFDEETGTLTLVQTVAEGENPSWLAVSPDGRRLYVVNEGSG-----DSGGVSSYRIDPDTGTL 76 (345)
T ss_dssp EEEECCSSSSTEE-EEEEEETTTTEEEEEEEEEESSSECCEEE-TTSSEEEEEETTSS-----TTTEEEEEEEETTTTEE
T ss_pred EEEcCCCCCCCcE-EEEEEcCCCCCceEeeeecCCCCCceEEEEeCCCEEEEEEcccc-----CCCCEEEEEECCCccee
Confidence 3455553 22222 36777889999987654322111112222235778999854320 13445555 5545688
Q ss_pred EeCCCCCCCCCCceEEEE---CCEEEEE
Q 014195 203 QDLPPLPVPRYAPATQLW---RGRLHVM 227 (429)
Q Consensus 203 ~~~~~~p~~r~~~~~~~~---~~~lyv~ 227 (429)
+.+...+......+-+.+ +..||+.
T Consensus 77 ~~~~~~~~~g~~p~~i~~~~~g~~l~va 104 (345)
T PF10282_consen 77 TLLNSVPSGGSSPCHIAVDPDGRFLYVA 104 (345)
T ss_dssp EEEEEEEESSSCEEEEEECTTSSEEEEE
T ss_pred EEeeeeccCCCCcEEEEEecCCCEEEEE
Confidence 887665532333233333 4456665
No 101
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=84.06 E-value=23 Score=33.27 Aligned_cols=110 Identities=16% Similarity=0.165 Sum_probs=62.5
Q ss_pred ceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCC-eEEcCCCCCCCCCc
Q 014195 255 EWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMK-WKVLPSMPKPDSHI 332 (429)
Q Consensus 255 ~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~-W~~~~~~~~~r~~~ 332 (429)
+++.+........-.+++.++++|.+.-|.. ++.|+ .... +...+.+..+-.
T Consensus 78 ~l~~i~~~~~~g~V~ai~~~~~~lv~~~g~~------------------------l~v~~l~~~~~l~~~~~~~~~~~-- 131 (321)
T PF03178_consen 78 KLKLIHSTEVKGPVTAICSFNGRLVVAVGNK------------------------LYVYDLDNSKTLLKKAFYDSPFY-- 131 (321)
T ss_dssp EEEEEEEEEESS-EEEEEEETTEEEEEETTE------------------------EEEEEEETTSSEEEEEEE-BSSS--
T ss_pred EEEEEEEEeecCcceEhhhhCCEEEEeecCE------------------------EEEEEccCcccchhhheecceEE--
Confidence 4444433333343457788899976666642 44554 4444 888776554442
Q ss_pred ceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceeeeeeEEE-CCEEEEEcc
Q 014195 333 EFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGYW-NGWLYFTSG 402 (429)
Q Consensus 333 ~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~-~~~i~v~GG 402 (429)
..++.+.++.|++.--.. .- .++.|+.+..+-..++.-..++.-.++..+ ++. .++++
T Consensus 132 i~sl~~~~~~I~vgD~~~-sv----------~~~~~~~~~~~l~~va~d~~~~~v~~~~~l~d~~-~~i~~ 190 (321)
T PF03178_consen 132 ITSLSVFKNYILVGDAMK-SV----------SLLRYDEENNKLILVARDYQPRWVTAAEFLVDED-TIIVG 190 (321)
T ss_dssp EEEEEEETTEEEEEESSS-SE----------EEEEEETTTE-EEEEEEESS-BEEEEEEEE-SSS-EEEEE
T ss_pred EEEEeccccEEEEEEccc-CE----------EEEEEEccCCEEEEEEecCCCccEEEEEEecCCc-EEEEE
Confidence 345677788666543332 11 466778877778888776667766666555 654 44434
No 102
>PRK00178 tolB translocation protein TolB; Provisional
Probab=84.05 E-value=45 Score=32.74 Aligned_cols=148 Identities=8% Similarity=0.085 Sum_probs=71.4
Q ss_pred CceeEEEeCCCCceEeCCCCCCCCCCceEEEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCC
Q 014195 189 TAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGP 267 (429)
Q Consensus 189 ~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~ 267 (429)
...++++|+.+.+-+.+...+..-. .....-++ +|++..-.++ ..+.|.+ |..+...+.+...+....
T Consensus 222 ~~~l~~~~l~~g~~~~l~~~~g~~~-~~~~SpDG~~la~~~~~~g-----~~~Iy~~-----d~~~~~~~~lt~~~~~~~ 290 (430)
T PRK00178 222 RPRIFVQNLDTGRREQITNFEGLNG-APAWSPDGSKLAFVLSKDG-----NPEIYVM-----DLASRQLSRVTNHPAIDT 290 (430)
T ss_pred CCEEEEEECCCCCEEEccCCCCCcC-CeEECCCCCEEEEEEccCC-----CceEEEE-----ECCCCCeEEcccCCCCcC
Confidence 4589999999988877764432111 11122244 4544322211 1233333 355666655443222111
Q ss_pred ceeEEEeCCE-EEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEE
Q 014195 268 HRACVVVDDR-LLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVI 345 (429)
Q Consensus 268 ~~~~~~~~~~-iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v 345 (429)
. ....-+++ |++.....+ ...+|.+| .+..++.+.... ...... ....+++.++
T Consensus 291 ~-~~~spDg~~i~f~s~~~g--------------------~~~iy~~d~~~g~~~~lt~~~--~~~~~~-~~Spdg~~i~ 346 (430)
T PRK00178 291 E-PFWGKDGRTLYFTSDRGG--------------------KPQIYKVNVNGGRAERVTFVG--NYNARP-RLSADGKTLV 346 (430)
T ss_pred C-eEECCCCCEEEEEECCCC--------------------CceEEEEECCCCCEEEeecCC--CCccce-EECCCCCEEE
Confidence 1 12223444 554432211 12488888 777777764221 111111 2334554444
Q ss_pred EcccCCCCCCccceeeeCcEEEEecCCCCeEEecc
Q 014195 346 VGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGK 380 (429)
Q Consensus 346 ~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~ 380 (429)
+....... ..++.+|+.+...+.+..
T Consensus 347 ~~~~~~~~---------~~l~~~dl~tg~~~~lt~ 372 (430)
T PRK00178 347 MVHRQDGN---------FHVAAQDLQRGSVRILTD 372 (430)
T ss_pred EEEccCCc---------eEEEEEECCCCCEEEccC
Confidence 44332221 269999999988877643
No 103
>cd00094 HX Hemopexin-like repeats.; Hemopexin is a heme-binding protein that transports heme to the liver. Hemopexin-like repeats occur in vitronectin and some matrix metalloproteinases family (matrixins). The HX repeats of some matrixins bind tissue inhibitor of metalloproteinases (TIMPs). This CD contains 4 instances of the repeat.
Probab=83.77 E-value=28 Score=30.05 Aligned_cols=94 Identities=16% Similarity=0.188 Sum_probs=47.3
Q ss_pred EEEECCEEEEEeccCCCCceeeeEEEEECCCCce--eeCC----CCCCCCccceeeEEEeC-CEEEEEeCeeCCCCCCCC
Q 014195 117 AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTW--GGRF----DMPREMAHSHLGMVTDG-RYIYVVTGQYGPQCRGPT 189 (429)
Q Consensus 117 ~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W--~~~~----~~~~~~~r~~~~~~~~~-~~lyv~GG~~~~~~~~~~ 189 (429)
++...+++|+|-|. .+|+++...... ..+. .+|. ....++.... +++|+|-|
T Consensus 12 ~~~~~g~~y~FkG~--------~~w~~~~~~~~~~p~~I~~~w~~~p~---~IDAa~~~~~~~~~yfFkg---------- 70 (194)
T cd00094 12 VTTLRGELYFFKGR--------YFWRLSPGKPPGSPFLISSFWPSLPS---PVDAAFERPDTGKIYFFKG---------- 70 (194)
T ss_pred EEEeCCEEEEEeCC--------EEEEEeCCCCCCCCeEhhhhCCCCCC---CccEEEEECCCCEEEEECC----------
Confidence 34456889999762 477777652211 1121 1222 2233333333 88999955
Q ss_pred ceeEEEeCCCCceE---eCCCCCCC---CCCceEEEE--CCEEEEEeCCC
Q 014195 190 AHTFVLDTETKKWQ---DLPPLPVP---RYAPATQLW--RGRLHVMGGSG 231 (429)
Q Consensus 190 ~~~~~yd~~t~~W~---~~~~~p~~---r~~~~~~~~--~~~lyv~GG~~ 231 (429)
+..|+||..+..+. .+.....+ ..--++... ++++|+|-|..
T Consensus 71 ~~yw~~~~~~~~~~~Pk~i~~~~~~~~~~~iDAA~~~~~~~~~yfFkg~~ 120 (194)
T cd00094 71 DKYWVYTGKNLEPGYPKPISDLGFPPTVKQIDAALRWPDNGKTYFFKGDK 120 (194)
T ss_pred CEEEEEcCcccccCCCcchhhcCCCCCCCCccEEEEEcCCCEEEEEeCCE
Confidence 36778876642221 11111111 111223333 68999998854
No 104
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=83.46 E-value=32 Score=30.62 Aligned_cols=115 Identities=17% Similarity=0.187 Sum_probs=62.4
Q ss_pred CceeeCCCCCC---CCcccee-eEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEEC-C
Q 014195 148 NTWGGRFDMPR---EMAHSHL-GMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWR-G 222 (429)
Q Consensus 148 ~~W~~~~~~~~---~~~r~~~-~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~-~ 222 (429)
.-|+...|+.. +.|-... .+.--.|.|+..|| ...+++.|+++.+.++.-.- ..-+-|+++.-+ +
T Consensus 99 ~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgG---------D~~~y~~dlE~G~i~r~~rG-HtDYvH~vv~R~~~ 168 (325)
T KOG0649|consen 99 RLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGG---------DGVIYQVDLEDGRIQREYRG-HTDYVHSVVGRNAN 168 (325)
T ss_pred hhhhhcCccccCcccCCccceeEeccCCCcEEEecC---------CeEEEEEEecCCEEEEEEcC-CcceeeeeeecccC
Confidence 35877766544 2233332 33335788999987 46788999999988764211 123445555422 2
Q ss_pred EEEEEeCCCCCCCCccccceEeeeecCCccccceee-c-----cCCCC--CCCceeEEEeCCEEEEEccc
Q 014195 223 RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRT-E-----IPIPR--GGPHRACVVVDDRLLVIGGQ 284 (429)
Q Consensus 223 ~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~-~-----~~~p~--~~~~~~~~~~~~~iyv~GG~ 284 (429)
--.+.|+.+ ..+..|+. .+.+-.. + +..-| -...-.+...+..-+|+||-
T Consensus 169 ~qilsG~ED-----GtvRvWd~-------kt~k~v~~ie~yk~~~~lRp~~g~wigala~~edWlvCGgG 226 (325)
T KOG0649|consen 169 GQILSGAED-----GTVRVWDT-------KTQKHVSMIEPYKNPNLLRPDWGKWIGALAVNEDWLVCGGG 226 (325)
T ss_pred cceeecCCC-----ccEEEEec-------cccceeEEeccccChhhcCcccCceeEEEeccCceEEecCC
Confidence 233445544 35777873 3433322 1 22223 22223556666667777774
No 105
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=82.85 E-value=41 Score=31.37 Aligned_cols=192 Identities=15% Similarity=0.184 Sum_probs=85.6
Q ss_pred CCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC-CCCCC-C-CCceEEEEC
Q 014195 146 TDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP-PLPVP-R-YAPATQLWR 221 (429)
Q Consensus 146 ~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~-~~p~~-r-~~~~~~~~~ 221 (429)
..+.|+.+. +|. ...-..+... .++-|++|- ...+++=+---.+|+... +.+.+ . ...++...+
T Consensus 4 ~~~~W~~v~-l~t--~~~l~dV~F~d~~~G~~VG~---------~g~il~T~DGG~tW~~~~~~~~~~~~~~l~~I~f~~ 71 (302)
T PF14870_consen 4 SGNSWQQVS-LPT--DKPLLDVAFVDPNHGWAVGA---------YGTILKTTDGGKTWQPVSLDLDNPFDYHLNSISFDG 71 (302)
T ss_dssp SS--EEEEE--S---SS-EEEEEESSSS-EEEEET---------TTEEEEESSTTSS-EE-----S-----EEEEEEEET
T ss_pred cCCCcEEee-cCC--CCceEEEEEecCCEEEEEec---------CCEEEEECCCCccccccccCCCccceeeEEEEEecC
Confidence 456798874 333 2234445544 568888874 223333333456799876 33332 2 223344457
Q ss_pred CEEEEEeCCCCCCCCccccceEeeeecCCccccceeecc---CCCCCCCceeEE-EeCCEEEEEcccCCCCCCCCCCCcc
Q 014195 222 GRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEI---PIPRGGPHRACV-VVDDRLLVIGGQEGDFMAKPGSPIF 297 (429)
Q Consensus 222 ~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~---~~p~~~~~~~~~-~~~~~iyv~GG~~~~~~~~~~~~~~ 297 (429)
++.|++|-.. -.+.- ...-.+|++++ ++|... ..+. .-++.+.++|.. +
T Consensus 72 ~~g~ivG~~g--------~ll~T-----~DgG~tW~~v~l~~~lpgs~--~~i~~l~~~~~~l~~~~-G----------- 124 (302)
T PF14870_consen 72 NEGWIVGEPG--------LLLHT-----TDGGKTWERVPLSSKLPGSP--FGITALGDGSAELAGDR-G----------- 124 (302)
T ss_dssp TEEEEEEETT--------EEEEE-----SSTTSS-EE----TT-SS-E--EEEEEEETTEEEEEETT-------------
T ss_pred CceEEEcCCc--------eEEEe-----cCCCCCcEEeecCCCCCCCe--eEEEEcCCCcEEEEcCC-C-----------
Confidence 8899987421 01111 13567888864 233322 2333 345667776643 1
Q ss_pred ccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeE
Q 014195 298 KCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWH 376 (429)
Q Consensus 298 ~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~ 376 (429)
.+|+-. ...+|+.+..-.. ..........++++++++.. ++ -....|+....|+
T Consensus 125 -----------~iy~T~DgG~tW~~~~~~~~--gs~~~~~r~~dG~~vavs~~-G~-----------~~~s~~~G~~~w~ 179 (302)
T PF14870_consen 125 -----------AIYRTTDGGKTWQAVVSETS--GSINDITRSSDGRYVAVSSR-GN-----------FYSSWDPGQTTWQ 179 (302)
T ss_dssp ------------EEEESSTTSSEEEEE-S------EEEEEE-TTS-EEEEETT-SS-----------EEEEE-TT-SS-E
T ss_pred -----------cEEEeCCCCCCeeEcccCCc--ceeEeEEECCCCcEEEEECc-cc-----------EEEEecCCCccce
Confidence 277776 7889998764322 11111223445676666633 21 2335688888899
Q ss_pred EecccCcceeeeeeEEECCEEEEEc
Q 014195 377 VIGKLPYRVKTTLAGYWNGWLYFTS 401 (429)
Q Consensus 377 ~v~~lp~~r~~~~~~~~~~~i~v~G 401 (429)
........|-......-++.|+++.
T Consensus 180 ~~~r~~~~riq~~gf~~~~~lw~~~ 204 (302)
T PF14870_consen 180 PHNRNSSRRIQSMGFSPDGNLWMLA 204 (302)
T ss_dssp EEE--SSS-EEEEEE-TTS-EEEEE
T ss_pred EEccCccceehhceecCCCCEEEEe
Confidence 8765555554444444556666653
No 106
>PF09910 DUF2139: Uncharacterized protein conserved in archaea (DUF2139); InterPro: IPR016675 There is currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=82.41 E-value=41 Score=31.00 Aligned_cols=162 Identities=16% Similarity=0.123 Sum_probs=86.8
Q ss_pred eeCCCCCCCCccceeeEEEeCCEEEEEeCeeC-------CC-------CCCCCceeEEEeCCCCc----eEeCCCCCCCC
Q 014195 151 GGRFDMPREMAHSHLGMVTDGRYIYVVTGQYG-------PQ-------CRGPTAHTFVLDTETKK----WQDLPPLPVPR 212 (429)
Q Consensus 151 ~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~-------~~-------~~~~~~~~~~yd~~t~~----W~~~~~~p~~r 212 (429)
+.+.+.|..-.-.+-++...++.|| |||+-. .. ..+..+.+..||.++++ |.+- +..++
T Consensus 26 elvG~~P~SGGDTYNAV~~vDd~Iy-FGGWVHAPa~y~gk~~g~~~IdF~NKYSHVH~yd~e~~~VrLLWkes--ih~~~ 102 (339)
T PF09910_consen 26 ELVGPPPTSGGDTYNAVEWVDDFIY-FGGWVHAPAVYEGKGDGRATIDFRNKYSHVHEYDTENDSVRLLWKES--IHDKT 102 (339)
T ss_pred eeccCCCCCCCccceeeeeecceEE-EeeeecCCceeeeccCCceEEEEeeccceEEEEEcCCCeEEEEEecc--cCCcc
Confidence 4566666544455677778888777 788621 10 01225789999999887 5443 22223
Q ss_pred CCceEE------EECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCC
Q 014195 213 YAPATQ------LWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEG 286 (429)
Q Consensus 213 ~~~~~~------~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~ 286 (429)
....=+ .++++|++.=+-.- ....+|.+. ..+..=+.+...|... .+.+.+..+|-+ .+.
T Consensus 103 ~WaGEVSdIlYdP~~D~LLlAR~DGh----~nLGvy~ld-----r~~g~~~~L~~~ps~K---G~~~~D~a~F~i--~~~ 168 (339)
T PF09910_consen 103 KWAGEVSDILYDPYEDRLLLARADGH----ANLGVYSLD-----RRTGKAEKLSSNPSLK---GTLVHDYACFGI--NNF 168 (339)
T ss_pred ccccchhheeeCCCcCEEEEEecCCc----ceeeeEEEc-----ccCCceeeccCCCCcC---ceEeeeeEEEec--ccc
Confidence 222222 23677887743221 235566653 5555555554444443 444555555544 221
Q ss_pred CCCCCCCCCccccccCCeeeeCceEEeC-CCCCe--EEcCCC------CCCCCCcceeEEEECCEEEEEc
Q 014195 287 DFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKW--KVLPSM------PKPDSHIEFAWVLVNNSIVIVG 347 (429)
Q Consensus 287 ~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W--~~~~~~------~~~r~~~~~~~~~~~~~i~v~G 347 (429)
.. -.+.+.++| .+.+| +..+.- +.-+...+ .++...+++|.|=
T Consensus 169 ~~-----------------g~~~i~~~Dli~~~~~~e~f~~~~s~Dg~~~~~~~~G-~~~s~ynR~faF~ 220 (339)
T PF09910_consen 169 HK-----------------GVSGIHCLDLISGKWVIESFDVSLSVDGGPVIRPELG-AMASAYNRLFAFV 220 (339)
T ss_pred cc-----------------CCceEEEEEccCCeEEEEecccccCCCCCceEeeccc-cEEEEeeeEEEEE
Confidence 11 134588999 89999 443311 11122222 3577778877764
No 107
>PF13088 BNR_2: BNR repeat-like domain; PDB: 2F11_A 2F0Z_A 1VCU_B 2F25_B 1SO7_A 2F29_A 1SNT_A 2F13_A 2F28_A 2F27_A ....
Probab=81.44 E-value=42 Score=30.48 Aligned_cols=222 Identities=19% Similarity=0.215 Sum_probs=101.9
Q ss_pred CCCceeeC---CCCCCCCccceeeEEE--eCCEEEEEeCeeCCCC-CCCCceeEEEeCC-CCceEeCCCCCCC------C
Q 014195 146 TDNTWGGR---FDMPREMAHSHLGMVT--DGRYIYVVTGQYGPQC-RGPTAHTFVLDTE-TKKWQDLPPLPVP------R 212 (429)
Q Consensus 146 ~~~~W~~~---~~~~~~~~r~~~~~~~--~~~~lyv~GG~~~~~~-~~~~~~~~~yd~~-t~~W~~~~~~p~~------r 212 (429)
...+|... .+.+.+..+....+.+ .+++|+++-....... .....-.+....+ -.+|+....++.. .
T Consensus 28 ~G~tWs~~~~v~~~~~~~~~~~~p~~~~~~~g~l~l~~~~~~~~~~~~~~~~~~~~S~D~G~TWs~~~~l~~~~~~~~~~ 107 (275)
T PF13088_consen 28 GGKTWSEPRIVADGPKPGRRYGNPSLVVDPDGRLWLFYSAGSSGGGWSGSRIYYSRSTDGGKTWSEPTDLPPGWFGNFSG 107 (275)
T ss_dssp CTTEEEEEEEEETSTBTTCEEEEEEEEEETTSEEEEEEEEEETTESCCTCEEEEEEESSTTSS-EEEEEEHHHCCCSCEE
T ss_pred CCCeeCCCEEEeeccccCCcccCcEEEEeCCCCEEEEEEEccCCCCCCceeEEEEEECCCCCCCCCccccccccccceec
Confidence 34679863 2333111233333332 3889998862221111 0001112244444 5689987543321 1
Q ss_pred CCce--EEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCC-CC-ceeEEE-eCCEEEEEcccCCC
Q 014195 213 YAPA--TQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRG-GP-HRACVV-VDDRLLVIGGQEGD 287 (429)
Q Consensus 213 ~~~~--~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~-~~-~~~~~~-~~~~iyv~GG~~~~ 287 (429)
.... +..-++++++.. +.. ....+...+..-+....+|+...+.+.. .. ..+.+. -+++|+++--....
T Consensus 108 ~~~~~~i~~~~G~l~~~~-~~~-----~~~~~~~~~~~S~D~G~tW~~~~~~~~~~~~~e~~~~~~~dG~l~~~~R~~~~ 181 (275)
T PF13088_consen 108 PGRGPPIQLPDGRLIAPY-YHE-----SGGSFSAFVYYSDDGGKTWSSGSPIPDGQGECEPSIVELPDGRLLAVFRTEGN 181 (275)
T ss_dssp CSEEEEEEECTTEEEEEE-EEE-----SSCEEEEEEEEESSTTSSEEEEEECECSEEEEEEEEEEETTSEEEEEEEECSS
T ss_pred cceeeeeEecCCCEEEEE-eec-----cccCcceEEEEeCCCCceeeccccccccCCcceeEEEECCCCcEEEEEEccCC
Confidence 1222 334478888872 110 1111222222224567789887665322 22 223332 36788887643211
Q ss_pred CCCCCCCCccccccCCeeeeCceEEeCCCCCeEEcC--CCCCCCCCcceeEEE-ECCEEEEEcccCCCCCCccceeeeCc
Q 014195 288 FMAKPGSPIFKCSRRNEVVYDDVYMLDDEMKWKVLP--SMPKPDSHIEFAWVL-VNNSIVIVGGTTEKHPTTKKMVLVGE 364 (429)
Q Consensus 288 ~~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W~~~~--~~~~~r~~~~~~~~~-~~~~i~v~GG~~~~~~~~~~~~~~~~ 364 (429)
. ..--...-|...+|+... .+|.+... ..++. .+++++++........ --.
T Consensus 182 ~-----------------~~~~~~S~D~G~TWs~~~~~~~~~~~~~--~~~~~~~~g~~~~~~~~~~~r~-------~l~ 235 (275)
T PF13088_consen 182 D-----------------DIYISRSTDGGRTWSPPQPTNLPNPNSS--ISLVRLSDGRLLLVYNNPDGRS-------NLS 235 (275)
T ss_dssp T-----------------EEEEEEESSTTSS-EEEEEEECSSCCEE--EEEEECTTSEEEEEEECSSTSE-------EEE
T ss_pred C-----------------cEEEEEECCCCCcCCCceecccCcccCC--ceEEEcCCCCEEEEEECCCCCC-------ceE
Confidence 0 000112223577999865 34444432 22233 4678888887322211 113
Q ss_pred EEEEecCCCCeEEecccCcce----eeeeeEEE-CCEEEE
Q 014195 365 IFQFNLNTLKWHVIGKLPYRV----KTTLAGYW-NGWLYF 399 (429)
Q Consensus 365 i~~yd~~~~~W~~v~~lp~~r----~~~~~~~~-~~~i~v 399 (429)
+++-.-...+|+....+.... .+..++.. +++|+|
T Consensus 236 l~~S~D~g~tW~~~~~i~~~~~~~~~Y~~~~~~~dg~l~i 275 (275)
T PF13088_consen 236 LYVSEDGGKTWSRPKTIDDGPNGDSGYPSLTQLPDGKLYI 275 (275)
T ss_dssp EEEECTTCEEEEEEEEEEEEE-CCEEEEEEEEEETTEEEE
T ss_pred EEEEeCCCCcCCccEEEeCCCCCcEECCeeEEeCCCcCCC
Confidence 333333478998775554433 34445544 579986
No 108
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=81.18 E-value=56 Score=31.78 Aligned_cols=147 Identities=15% Similarity=0.097 Sum_probs=71.7
Q ss_pred CceeEEEeCCCCceEeCCCCCCCCCCceEEEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCC
Q 014195 189 TAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGP 267 (429)
Q Consensus 189 ~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~ 267 (429)
...++++|+.+.+-..+...+...... ...-++ +|++....++ ..+.|.. |..+...+.+...+....
T Consensus 213 ~~~i~v~d~~~g~~~~~~~~~~~~~~~-~~spDg~~l~~~~~~~~-----~~~i~~~-----d~~~~~~~~l~~~~~~~~ 281 (417)
T TIGR02800 213 KPEIYVQDLATGQREKVASFPGMNGAP-AFSPDGSKLAVSLSKDG-----NPDIYVM-----DLDGKQLTRLTNGPGIDT 281 (417)
T ss_pred CcEEEEEECCCCCEEEeecCCCCccce-EECCCCCEEEEEECCCC-----CccEEEE-----ECCCCCEEECCCCCCCCC
Confidence 357999999988776665443222221 222244 4555433221 1233332 244444444433221111
Q ss_pred ceeEEEeCCE-EEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEE
Q 014195 268 HRACVVVDDR-LLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVI 345 (429)
Q Consensus 268 ~~~~~~~~~~-iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v 345 (429)
. .....+++ |++.....+ ...+|.+| .+..++.+.... ...... ....+++.++
T Consensus 282 ~-~~~s~dg~~l~~~s~~~g--------------------~~~iy~~d~~~~~~~~l~~~~--~~~~~~-~~spdg~~i~ 337 (417)
T TIGR02800 282 E-PSWSPDGKSIAFTSDRGG--------------------SPQIYMMDADGGEVRRLTFRG--GYNASP-SWSPDGDLIA 337 (417)
T ss_pred C-EEECCCCCEEEEEECCCC--------------------CceEEEEECCCCCEEEeecCC--CCccCe-EECCCCCEEE
Confidence 1 12223454 444332211 12488888 677776664321 111111 2345666666
Q ss_pred EcccCCCCCCccceeeeCcEEEEecCCCCeEEec
Q 014195 346 VGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIG 379 (429)
Q Consensus 346 ~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~ 379 (429)
+....... ..++.+|+.+..++.+.
T Consensus 338 ~~~~~~~~---------~~i~~~d~~~~~~~~l~ 362 (417)
T TIGR02800 338 FVHREGGG---------FNIAVMDLDGGGERVLT 362 (417)
T ss_pred EEEccCCc---------eEEEEEeCCCCCeEEcc
Confidence 66544321 27999999987777664
No 109
>PF08268 FBA_3: F-box associated domain; InterPro: IPR013187 This domain occurs in a diverse superfamily of genes in plants. Most examples are found C-terminal to an F-box (IPR001810 from INTERPRO), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes []. Some members have two copies of this domain.
Probab=80.90 E-value=18 Score=28.79 Aligned_cols=83 Identities=13% Similarity=0.115 Sum_probs=53.2
Q ss_pred ECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCC-CCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEE-eC
Q 014195 120 IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDM-PREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVL-DT 197 (429)
Q Consensus 120 ~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~-~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~y-d~ 197 (429)
++|-+|-..-.. ......+-+||..+++|+.+... ..........++.++|+|-++.-..... ...-++|+. |.
T Consensus 4 inGvly~~a~~~--~~~~~~IvsFDv~~E~f~~i~~P~~~~~~~~~~~L~~~~G~L~~v~~~~~~~--~~~~~iWvLeD~ 79 (129)
T PF08268_consen 4 INGVLYWLAWSE--DSDNNVIVSFDVRSEKFRFIKLPEDPYSSDCSSTLIEYKGKLALVSYNDQGE--PDSIDIWVLEDY 79 (129)
T ss_pred ECcEEEeEEEEC--CCCCcEEEEEEcCCceEEEEEeeeeeccccCccEEEEeCCeEEEEEecCCCC--cceEEEEEeecc
Confidence 577777766551 11234589999999999877432 1222456677888899988875433221 113577877 56
Q ss_pred CCCceEeCC
Q 014195 198 ETKKWQDLP 206 (429)
Q Consensus 198 ~t~~W~~~~ 206 (429)
.+++|.+..
T Consensus 80 ~k~~Wsk~~ 88 (129)
T PF08268_consen 80 EKQEWSKKH 88 (129)
T ss_pred ccceEEEEE
Confidence 678899763
No 110
>PLN03215 ascorbic acid mannose pathway regulator 1; Provisional
Probab=80.80 E-value=45 Score=32.06 Aligned_cols=106 Identities=10% Similarity=0.120 Sum_probs=57.8
Q ss_pred ccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeCCCCCeEEcCC-----CCC
Q 014195 253 EKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLDDEMKWKVLPS-----MPK 327 (429)
Q Consensus 253 ~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W~~~~~-----~~~ 327 (429)
.+.|+.+.. .... .--++.++|++|++.-. + +++.++....-+++++ +..
T Consensus 189 ~~~Wt~l~~-~~~~-~~DIi~~kGkfYAvD~~-G----------------------~l~~i~~~l~i~~v~~~i~~~~~~ 243 (373)
T PLN03215 189 GNVLKALKQ-MGYH-FSDIIVHKGQTYALDSI-G----------------------IVYWINSDLEFSRFGTSLDENITD 243 (373)
T ss_pred CCeeeEccC-CCce-eeEEEEECCEEEEEcCC-C----------------------eEEEEecCCceeeecceecccccC
Confidence 378888754 2222 34788999999998421 1 2454441111122221 111
Q ss_pred CCCCcceeEEEECCEEEEEcccCCCCCC-------ccceeeeCcEEEEecCCCCeEEecccCc
Q 014195 328 PDSHIEFAWVLVNNSIVIVGGTTEKHPT-------TKKMVLVGEIFQFNLNTLKWHVIGKLPY 383 (429)
Q Consensus 328 ~r~~~~~~~~~~~~~i~v~GG~~~~~~~-------~~~~~~~~~i~~yd~~~~~W~~v~~lp~ 383 (429)
.........+...|+++++..+...... ....+..-.|+..|.+..+|.++..|..
T Consensus 244 g~~~~~~yLVEs~GdLLmV~R~~~~~~~~~~~~~~~~~~t~~f~VfklD~~~~~WveV~sLgd 306 (373)
T PLN03215 244 GCWTGDRRFVECCGELYIVERLPKESTWKRKADGFEYSRTVGFKVYKFDDELAKWMEVKTLGD 306 (373)
T ss_pred CcccCceeEEEECCEEEEEEEEccCcccccccccccccceeEEEEEEEcCCCCcEEEecccCC
Confidence 1111122357788999999885322110 0011123367778988999999987754
No 111
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=79.87 E-value=44 Score=29.80 Aligned_cols=121 Identities=18% Similarity=0.252 Sum_probs=66.3
Q ss_pred CCeEEccCCC-----CCccCCcEEE-ECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CC
Q 014195 100 LKWEKMKAAP-----VPRLDGAAIQ-IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GR 172 (429)
Q Consensus 100 ~~W~~~~~~p-----~~R~~~~~~~-~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~ 172 (429)
..|+...++. .|-....... -.|.|+.+||. ..++..|.++++.+..-.-.. -+-|+++.- .+
T Consensus 99 ~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD-------~~~y~~dlE~G~i~r~~rGHt---DYvH~vv~R~~~ 168 (325)
T KOG0649|consen 99 RLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGD-------GVIYQVDLEDGRIQREYRGHT---DYVHSVVGRNAN 168 (325)
T ss_pred hhhhhcCccccCcccCCccceeEeccCCCcEEEecCC-------eEEEEEEecCCEEEEEEcCCc---ceeeeeeecccC
Confidence 3576665543 2332222222 35788888873 358899999998876522221 344666652 22
Q ss_pred EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeC-C-----CCCCCCCCc--eEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 173 YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDL-P-----PLPVPRYAP--ATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 173 ~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~-~-----~~p~~r~~~--~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
-=.+.|+.++ .+-.+|..|.+-..+ . ....|..+. .+...+....|.||- +....|.+
T Consensus 169 ~qilsG~EDG--------tvRvWd~kt~k~v~~ie~yk~~~~lRp~~g~wigala~~edWlvCGgG------p~lslwhL 234 (325)
T KOG0649|consen 169 GQILSGAEDG--------TVRVWDTKTQKHVSMIEPYKNPNLLRPDWGKWIGALAVNEDWLVCGGG------PKLSLWHL 234 (325)
T ss_pred cceeecCCCc--------cEEEEeccccceeEEeccccChhhcCcccCceeEEEeccCceEEecCC------CceeEEec
Confidence 2334555443 455678888776554 2 222333333 444556667777764 34556765
No 112
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=79.07 E-value=43 Score=34.06 Aligned_cols=97 Identities=18% Similarity=0.295 Sum_probs=56.0
Q ss_pred CcEEEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCC------ccceeeEEEeCCEEEEEeCeeCCCCC
Q 014195 115 GAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREM------AHSHLGMVTDGRYIYVVTGQYGPQCR 186 (429)
Q Consensus 115 ~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~------~r~~~~~~~~~~~lyv~GG~~~~~~~ 186 (429)
.+-++.++.||+.... ..++++|..+.+ |+.-...+... .....++++.+++||+...
T Consensus 63 stPvv~~g~vyv~s~~-------g~v~AlDa~TGk~lW~~~~~~~~~~~~~~~~~~~~rg~av~~~~v~v~t~------- 128 (527)
T TIGR03075 63 SQPLVVDGVMYVTTSY-------SRVYALDAKTGKELWKYDPKLPDDVIPVMCCDVVNRGVALYDGKVFFGTL------- 128 (527)
T ss_pred cCCEEECCEEEEECCC-------CcEEEEECCCCceeeEecCCCCcccccccccccccccceEECCEEEEEcC-------
Confidence 3445668999986432 248889988764 87543332110 0112345677888886422
Q ss_pred CCCceeEEEeCCCCc--eEeCC-CCCCC-CCCceEEEECCEEEEE
Q 014195 187 GPTAHTFVLDTETKK--WQDLP-PLPVP-RYAPATQLWRGRLHVM 227 (429)
Q Consensus 187 ~~~~~~~~yd~~t~~--W~~~~-~~p~~-r~~~~~~~~~~~lyv~ 227 (429)
...++++|.+|.+ |+.-. .+... ....+-++.+++||+-
T Consensus 129 --dg~l~ALDa~TGk~~W~~~~~~~~~~~~~tssP~v~~g~Vivg 171 (527)
T TIGR03075 129 --DARLVALDAKTGKVVWSKKNGDYKAGYTITAAPLVVKGKVITG 171 (527)
T ss_pred --CCEEEEEECCCCCEEeecccccccccccccCCcEEECCEEEEe
Confidence 3578999998875 77532 22211 1223345668887775
No 113
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=78.92 E-value=51 Score=29.99 Aligned_cols=180 Identities=12% Similarity=0.100 Sum_probs=87.6
Q ss_pred hhcceeeeecCCCcccceeeeeeecCCCCe-EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccCCC
Q 014195 31 LVADFFWASSSKFTSSYLNIASNWSPYHNS-IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKAAP 109 (429)
Q Consensus 31 ~~~~~ly~~GG~~~~~~~~~~~~yd~~~~~-~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p 109 (429)
.-++...+.+++|+ ++-.||.++.+ ++.=-.+.+--++++...+....+.....+ .-+-|..++...
T Consensus 72 s~dg~~alS~swD~-----~lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivSGSrDk-------Tiklwnt~g~ck 139 (315)
T KOG0279|consen 72 SSDGNFALSASWDG-----TLRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVSGSRDK-------TIKLWNTLGVCK 139 (315)
T ss_pred ccCCceEEeccccc-----eEEEEEecCCcEEEEEEecCCceEEEEecCCCceeecCCCcc-------eeeeeeecccEE
Confidence 34556667777777 66788888866 322222122222333322222222222222 223454444332
Q ss_pred CC------ccCCcEEEE--C--CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeC
Q 014195 110 VP------RLDGAAIQI--K--NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTG 179 (429)
Q Consensus 110 ~~------R~~~~~~~~--~--~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG 179 (429)
.. |.--+++.. + +.+++-+|++. .+-++|..+-+-.. ..+.....-....+..++.+.+.||
T Consensus 140 ~t~~~~~~~~WVscvrfsP~~~~p~Ivs~s~Dk------tvKvWnl~~~~l~~--~~~gh~~~v~t~~vSpDGslcasGg 211 (315)
T KOG0279|consen 140 YTIHEDSHREWVSCVRFSPNESNPIIVSASWDK------TVKVWNLRNCQLRT--TFIGHSGYVNTVTVSPDGSLCASGG 211 (315)
T ss_pred EEEecCCCcCcEEEEEEcCCCCCcEEEEccCCc------eEEEEccCCcchhh--ccccccccEEEEEECCCCCEEecCC
Confidence 11 222222222 2 45777777654 36777876654332 2222112223334445889999999
Q ss_pred eeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEee
Q 014195 180 QYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLA 245 (429)
Q Consensus 180 ~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~ 245 (429)
.++ .+..+|+...+= +..+...-.-++++..-++..++-+.. .++..|+++
T Consensus 212 kdg--------~~~LwdL~~~k~--lysl~a~~~v~sl~fspnrywL~~at~-----~sIkIwdl~ 262 (315)
T KOG0279|consen 212 KDG--------EAMLWDLNEGKN--LYSLEAFDIVNSLCFSPNRYWLCAATA-----TSIKIWDLE 262 (315)
T ss_pred CCc--------eEEEEEccCCce--eEeccCCCeEeeEEecCCceeEeeccC-----CceEEEecc
Confidence 765 344555554432 223333333455666667777766644 346667653
No 114
>PRK04922 tolB translocation protein TolB; Provisional
Probab=78.45 E-value=72 Score=31.44 Aligned_cols=148 Identities=9% Similarity=0.006 Sum_probs=69.2
Q ss_pred CceeEEEeCCCCceEeCCCCCCCCCCceEEEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCC
Q 014195 189 TAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGP 267 (429)
Q Consensus 189 ~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~ 267 (429)
...++++|+.+++-+.+...+.... .....-++ +|++....++ ..+.|.+ |..+..-+.+........
T Consensus 227 ~~~l~~~dl~~g~~~~l~~~~g~~~-~~~~SpDG~~l~~~~s~~g-----~~~Iy~~-----d~~~g~~~~lt~~~~~~~ 295 (433)
T PRK04922 227 RSAIYVQDLATGQRELVASFRGING-APSFSPDGRRLALTLSRDG-----NPEIYVM-----DLGSRQLTRLTNHFGIDT 295 (433)
T ss_pred CcEEEEEECCCCCEEEeccCCCCcc-CceECCCCCEEEEEEeCCC-----CceEEEE-----ECCCCCeEECccCCCCcc
Confidence 4579999999988777765442111 11222244 4554432221 1233332 244444444332221111
Q ss_pred ceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEE
Q 014195 268 HRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIV 346 (429)
Q Consensus 268 ~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~ 346 (429)
.....-+++-+++...... ...+|.+| .+...+.+... ....... ....+++.+++
T Consensus 296 -~~~~spDG~~l~f~sd~~g-------------------~~~iy~~dl~~g~~~~lt~~--g~~~~~~-~~SpDG~~Ia~ 352 (433)
T PRK04922 296 -EPTWAPDGKSIYFTSDRGG-------------------RPQIYRVAASGGSAERLTFQ--GNYNARA-SVSPDGKKIAM 352 (433)
T ss_pred -ceEECCCCCEEEEEECCCC-------------------CceEEEEECCCCCeEEeecC--CCCccCE-EECCCCCEEEE
Confidence 1222335553333322111 12488888 67777766421 1121122 23345544444
Q ss_pred cccCCCCCCccceeeeCcEEEEecCCCCeEEec
Q 014195 347 GGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIG 379 (429)
Q Consensus 347 GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~ 379 (429)
....... ..++++|+.++..+.+.
T Consensus 353 ~~~~~~~---------~~I~v~d~~~g~~~~Lt 376 (433)
T PRK04922 353 VHGSGGQ---------YRIAVMDLSTGSVRTLT 376 (433)
T ss_pred EECCCCc---------eeEEEEECCCCCeEECC
Confidence 3222211 27999999888887664
No 115
>PRK03629 tolB translocation protein TolB; Provisional
Probab=78.32 E-value=73 Score=31.41 Aligned_cols=193 Identities=10% Similarity=0.036 Sum_probs=88.2
Q ss_pred eeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCce
Q 014195 137 HSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPA 216 (429)
Q Consensus 137 ~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~ 216 (429)
...+++.|.....=..+...+. .-......-.+.+|..+. .. .. ...++.+|+.+.+-+.+...+..-.. -
T Consensus 178 ~~~l~~~d~dg~~~~~lt~~~~--~~~~p~wSPDG~~la~~s-~~-~g----~~~i~i~dl~~G~~~~l~~~~~~~~~-~ 248 (429)
T PRK03629 178 PYELRVSDYDGYNQFVVHRSPQ--PLMSPAWSPDGSKLAYVT-FE-SG----RSALVIQTLANGAVRQVASFPRHNGA-P 248 (429)
T ss_pred ceeEEEEcCCCCCCEEeecCCC--ceeeeEEcCCCCEEEEEE-ec-CC----CcEEEEEECCCCCeEEccCCCCCcCC-e
Confidence 4568888876543333322221 111222222344444332 11 11 35789999988877776654432111 1
Q ss_pred EEEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCC
Q 014195 217 TQLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSP 295 (429)
Q Consensus 217 ~~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~ 295 (429)
...-++ +|++.....+ ..+.|.+ |..+.+.+.+...+.... .....-+++-+++......
T Consensus 249 ~~SPDG~~La~~~~~~g-----~~~I~~~-----d~~tg~~~~lt~~~~~~~-~~~wSPDG~~I~f~s~~~g-------- 309 (429)
T PRK03629 249 AFSPDGSKLAFALSKTG-----SLNLYVM-----DLASGQIRQVTDGRSNNT-EPTWFPDSQNLAYTSDQAG-------- 309 (429)
T ss_pred EECCCCCEEEEEEcCCC-----CcEEEEE-----ECCCCCEEEccCCCCCcC-ceEECCCCCEEEEEeCCCC--------
Confidence 222244 4555433221 1123332 244444444433221111 1222335554444332111
Q ss_pred ccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 296 IFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 296 ~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
...+|.+| .+..-+++..... . ........+++.+++.+..... .+++.+|++++.
T Consensus 310 -----------~~~Iy~~d~~~g~~~~lt~~~~--~-~~~~~~SpDG~~Ia~~~~~~g~---------~~I~~~dl~~g~ 366 (429)
T PRK03629 310 -----------RPQVYKVNINGGAPQRITWEGS--Q-NQDADVSSDGKFMVMVSSNGGQ---------QHIAKQDLATGG 366 (429)
T ss_pred -----------CceEEEEECCCCCeEEeecCCC--C-ccCEEECCCCCEEEEEEccCCC---------ceEEEEECCCCC
Confidence 12478887 6655555532111 1 1112234566555554433221 279999999998
Q ss_pred eEEecc
Q 014195 375 WHVIGK 380 (429)
Q Consensus 375 W~~v~~ 380 (429)
++.+..
T Consensus 367 ~~~Lt~ 372 (429)
T PRK03629 367 VQVLTD 372 (429)
T ss_pred eEEeCC
Confidence 887753
No 116
>PLN00181 protein SPA1-RELATED; Provisional
Probab=77.81 E-value=1.1e+02 Score=33.06 Aligned_cols=98 Identities=7% Similarity=0.053 Sum_probs=48.1
Q ss_pred CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe--CCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 122 NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD--GRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 122 ~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
+..++.|+.++ .+.+||..+++-.. .+... ...-.+++.. ++.+++.|+.+ ..+..||..+
T Consensus 545 ~~~las~~~Dg------~v~lWd~~~~~~~~--~~~~H-~~~V~~l~~~p~~~~~L~Sgs~D--------g~v~iWd~~~ 607 (793)
T PLN00181 545 KSQVASSNFEG------VVQVWDVARSQLVT--EMKEH-EKRVWSIDYSSADPTLLASGSDD--------GSVKLWSINQ 607 (793)
T ss_pred CCEEEEEeCCC------eEEEEECCCCeEEE--EecCC-CCCEEEEEEcCCCCCEEEEEcCC--------CEEEEEECCC
Confidence 34555565543 47788887664322 22111 1122334443 56778888753 3567788765
Q ss_pred CceEeCCCCCCCCCCceEEE---ECCEEEEEeCCCCCCCCccccceEe
Q 014195 200 KKWQDLPPLPVPRYAPATQL---WRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 200 ~~W~~~~~~p~~r~~~~~~~---~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
..-. ..+.. ......+. .+++++++|+.++ .+..|++
T Consensus 608 ~~~~--~~~~~-~~~v~~v~~~~~~g~~latgs~dg-----~I~iwD~ 647 (793)
T PLN00181 608 GVSI--GTIKT-KANICCVQFPSESGRSLAFGSADH-----KVYYYDL 647 (793)
T ss_pred CcEE--EEEec-CCCeEEEEEeCCCCCEEEEEeCCC-----eEEEEEC
Confidence 4321 11111 11111222 2467778877553 4556663
No 117
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=77.74 E-value=35 Score=32.19 Aligned_cols=197 Identities=15% Similarity=0.125 Sum_probs=85.1
Q ss_pred cceeeeecCC----CcccceeeeeeecCCCCe----EEecCCCCCCC----cceeeee-cC--CCCcCcccccccccccc
Q 014195 33 ADFFWASSSK----FTSSYLNIASNWSPYHNS----IILPNNGPQKG----ENIGVKT-KK--DVVPKRILPATFQDLPA 97 (429)
Q Consensus 33 ~~~ly~~GG~----~~~~~~~~~~~yd~~~~~----~~~p~~~~r~~----~~~~~~~-~~--~~~~~~~~~~~~~~~d~ 97 (429)
+..+|+..-+ .-....+-++.||+.|-+ +.||+. ||.. .....+. .. ..........++...|.
T Consensus 47 gk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k-~R~~~~~~~~~~~ls~dgk~~~V~N~TPa~SVtVVDl 125 (342)
T PF06433_consen 47 GKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPK-PRAQVVPYKNMFALSADGKFLYVQNFTPATSVTVVDL 125 (342)
T ss_dssp SSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS--B--BS--GGGEEE-TTSSEEEEEEESSSEEEEEEET
T ss_pred CCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCc-chheecccccceEEccCCcEEEEEccCCCCeEEEEEC
Confidence 4455655441 123467889999999987 677762 1221 1111111 11 11122223445556666
Q ss_pred cCCCeEEccCCC-------C-CccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEE
Q 014195 98 PELKWEKMKAAP-------V-PRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVT 169 (429)
Q Consensus 98 ~~~~W~~~~~~p-------~-~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~ 169 (429)
..++....-+.| . +|...+.|.-|.-+.|.=+.++... .....+||+..+-.-.-+.... .....-...
T Consensus 126 ~~~kvv~ei~~PGC~~iyP~~~~~F~~lC~DGsl~~v~Ld~~Gk~~-~~~t~~F~~~~dp~f~~~~~~~--~~~~~~F~S 202 (342)
T PF06433_consen 126 AAKKVVGEIDTPGCWLIYPSGNRGFSMLCGDGSLLTVTLDADGKEA-QKSTKVFDPDDDPLFEHPAYSR--DGGRLYFVS 202 (342)
T ss_dssp TTTEEEEEEEGTSEEEEEEEETTEEEEEETTSCEEEEEETSTSSEE-EEEEEESSTTTS-B-S--EEET--TTTEEEEEB
T ss_pred CCCceeeeecCCCEEEEEecCCCceEEEecCCceEEEEECCCCCEe-EeeccccCCCCcccccccceEC--CCCeEEEEe
Confidence 666543322222 1 1322222322223333223233332 3345788887764322211111 122445567
Q ss_pred eCCEEEEE--eCeeCCCCCCCCceeEEEeCCC-----CceEeCCCCCCCCCCceEEEECCEEEEEe--CCCCCCCCcccc
Q 014195 170 DGRYIYVV--TGQYGPQCRGPTAHTFVLDTET-----KKWQDLPPLPVPRYAPATQLWRGRLHVMG--GSGENRYTPEVD 240 (429)
Q Consensus 170 ~~~~lyv~--GG~~~~~~~~~~~~~~~yd~~t-----~~W~~~~~~p~~r~~~~~~~~~~~lyv~G--G~~~~~~~~~~~ 240 (429)
++|+||-+ +|.. ..-...+...+ ..|..- .....+.-.-.++|||.- |..+..-++..+
T Consensus 203 y~G~v~~~dlsg~~-------~~~~~~~~~~t~~e~~~~WrPG-----G~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgte 270 (342)
T PF06433_consen 203 YEGNVYSADLSGDS-------AKFGKPWSLLTDAEKADGWRPG-----GWQLIAYHAASGRLYVLMHQGGEGSHKDPGTE 270 (342)
T ss_dssp TTSEEEEEEETTSS-------EEEEEEEESS-HHHHHTTEEE------SSS-EEEETTTTEEEEEEEE--TT-TTS-EEE
T ss_pred cCCEEEEEeccCCc-------ccccCcccccCccccccCcCCc-----ceeeeeeccccCeEEEEecCCCCCCccCCceE
Confidence 78888884 3311 11122222222 345532 112122222367888874 444445577888
Q ss_pred ceEee
Q 014195 241 HWSLA 245 (429)
Q Consensus 241 ~~~~~ 245 (429)
+|.++
T Consensus 271 VWv~D 275 (342)
T PF06433_consen 271 VWVYD 275 (342)
T ss_dssp EEEEE
T ss_pred EEEEE
Confidence 88875
No 118
>PTZ00421 coronin; Provisional
Probab=77.32 E-value=85 Score=31.65 Aligned_cols=102 Identities=8% Similarity=-0.030 Sum_probs=49.4
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCcee-----eCCCCCCCCccceeeEEEe--CCEEEEEeCeeCCCCCCCCceeE
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWG-----GRFDMPREMAHSHLGMVTD--GRYIYVVTGQYGPQCRGPTAHTF 193 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~-----~~~~~~~~~~r~~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~ 193 (429)
++.+++.|+.++ .+.+||..++... .+..+... ...-.+++.. ++.+++.||.+ ..+.
T Consensus 87 d~~~LaSgS~Dg------tIkIWdi~~~~~~~~~~~~l~~L~gH-~~~V~~l~f~P~~~~iLaSgs~D--------gtVr 151 (493)
T PTZ00421 87 DPQKLFTASEDG------TIMGWGIPEEGLTQNISDPIVHLQGH-TKKVGIVSFHPSAMNVLASAGAD--------MVVN 151 (493)
T ss_pred CCCEEEEEeCCC------EEEEEecCCCccccccCcceEEecCC-CCcEEEEEeCcCCCCEEEEEeCC--------CEEE
Confidence 456777777654 3677887654321 11112111 1111223332 34577777653 4577
Q ss_pred EEeCCCCceEe-CCCCCCCCCCceEE-EECCEEEEEeCCCCCCCCccccceEe
Q 014195 194 VLDTETKKWQD-LPPLPVPRYAPATQ-LWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 194 ~yd~~t~~W~~-~~~~p~~r~~~~~~-~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
+||+.+.+-.. +..... .-.++. ..++.+++.|+.++ .+..|+.
T Consensus 152 IWDl~tg~~~~~l~~h~~--~V~sla~spdG~lLatgs~Dg-----~IrIwD~ 197 (493)
T PTZ00421 152 VWDVERGKAVEVIKCHSD--QITSLEWNLDGSLLCTTSKDK-----KLNIIDP 197 (493)
T ss_pred EEECCCCeEEEEEcCCCC--ceEEEEEECCCCEEEEecCCC-----EEEEEEC
Confidence 88888764221 111111 111122 23677888877653 4566763
No 119
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=76.46 E-value=82 Score=31.01 Aligned_cols=188 Identities=12% Similarity=0.141 Sum_probs=96.5
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
.++++++.+.++=+++.-.-. +-...+-..-++.|.|.--...+-. ....++..+....+...+ + ..-.+.
T Consensus 107 aDly~v~~e~Ge~kRiTyfGr--~fT~VaG~~~dg~iiV~TD~~tPF~--q~~~lYkv~~dg~~~e~L---n--lGpath 177 (668)
T COG4946 107 ADLYVVPSEDGEAKRITYFGR--RFTRVAGWIPDGEIIVSTDFHTPFS--QWTELYKVNVDGIKTEPL---N--LGPATH 177 (668)
T ss_pred ccEEEEeCCCCcEEEEEEecc--ccceeeccCCCCCEEEEeccCCCcc--cceeeeEEccCCceeeec---c--CCceee
Confidence 468888888887777654422 2122222334667777633221110 022333333333333322 2 222333
Q ss_pred EEECCEEEEEeCCCC-----CCC--CccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCC
Q 014195 218 QLWRGRLHVMGGSGE-----NRY--TPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMA 290 (429)
Q Consensus 218 ~~~~~~lyv~GG~~~-----~~~--~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~ 290 (429)
.+.++-+.++|-..- .+| -.....|.-. ....+.++...|+.-.. +-+.++++||.+--..+.+
T Consensus 178 iv~~dg~ivigRntydLP~WK~YkGGtrGklWis~-----d~g~tFeK~vdl~~~vS--~PmIV~~RvYFlsD~eG~G-- 248 (668)
T COG4946 178 IVIKDGIIVIGRNTYDLPHWKGYKGGTRGKLWISS-----DGGKTFEKFVDLDGNVS--SPMIVGERVYFLSDHEGVG-- 248 (668)
T ss_pred EEEeCCEEEEccCcccCcccccccCCccceEEEEe-----cCCcceeeeeecCCCcC--CceEEcceEEEEecccCcc--
Confidence 445555667764221 111 1223445422 22335566666665544 5567899999998776553
Q ss_pred CCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEe
Q 014195 291 KPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFN 369 (429)
Q Consensus 291 ~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd 369 (429)
.+|.-| +.+.-++-.+...--.++ +..+|+-+||--. .+||.||
T Consensus 249 ------------------nlYSvdldGkDlrrHTnFtdYY~R~----~nsDGkrIvFq~~-------------GdIylyd 293 (668)
T COG4946 249 ------------------NLYSVDLDGKDLRRHTNFTDYYPRN----ANSDGKRIVFQNA-------------GDIYLYD 293 (668)
T ss_pred ------------------ceEEeccCCchhhhcCCchhccccc----cCCCCcEEEEecC-------------CcEEEeC
Confidence 267666 554444444333222222 3456665555311 2899999
Q ss_pred cCCCCeEEe
Q 014195 370 LNTLKWHVI 378 (429)
Q Consensus 370 ~~~~~W~~v 378 (429)
|+++.-+++
T Consensus 294 P~td~lekl 302 (668)
T COG4946 294 PETDSLEKL 302 (668)
T ss_pred CCcCcceee
Confidence 999998886
No 120
>PRK04043 tolB translocation protein TolB; Provisional
Probab=76.42 E-value=82 Score=31.00 Aligned_cols=104 Identities=13% Similarity=0.109 Sum_probs=60.5
Q ss_pred ccccccccCCCeEEccCCCCCccCCcEEEECC-EEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEE
Q 014195 91 TFQDLPAPELKWEKMKAAPVPRLDGAAIQIKN-LLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVT 169 (429)
Q Consensus 91 ~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~-~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~ 169 (429)
.++.+|..+++=+.+...+..- ......-++ +|++.-..++ ..+++.+|..+.+++++...+. .-......-
T Consensus 214 ~Iyv~dl~tg~~~~lt~~~g~~-~~~~~SPDG~~la~~~~~~g----~~~Iy~~dl~~g~~~~LT~~~~--~d~~p~~SP 286 (419)
T PRK04043 214 TLYKYNLYTGKKEKIASSQGML-VVSDVSKDGSKLLLTMAPKG----QPDIYLYDTNTKTLTQITNYPG--IDVNGNFVE 286 (419)
T ss_pred EEEEEECCCCcEEEEecCCCcE-EeeEECCCCCEEEEEEccCC----CcEEEEEECCCCcEEEcccCCC--ccCccEECC
Confidence 5667777766555555432111 111122344 5555443322 2469999999999998866543 111222333
Q ss_pred eCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC
Q 014195 170 DGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP 207 (429)
Q Consensus 170 ~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~ 207 (429)
.+.+|++.-...+ ..+++.+|..+.+.+++..
T Consensus 287 DG~~I~F~Sdr~g------~~~Iy~~dl~~g~~~rlt~ 318 (419)
T PRK04043 287 DDKRIVFVSDRLG------YPNIFMKKLNSGSVEQVVF 318 (419)
T ss_pred CCCEEEEEECCCC------CceEEEEECCCCCeEeCcc
Confidence 4567777654321 4689999999998877753
No 121
>COG4257 Vgb Streptogramin lyase [Defense mechanisms]
Probab=76.40 E-value=62 Score=29.58 Aligned_cols=161 Identities=9% Similarity=-0.037 Sum_probs=77.8
Q ss_pred eeeeecCCCCe---EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccCCCCCccCCcEEEECCEEEE
Q 014195 50 IASNWSPYHNS---IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKNLLYV 126 (429)
Q Consensus 50 ~~~~yd~~~~~---~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~~iyv 126 (429)
-+-|+||++-. +++|...+..++-..++......=........-++||.++.-+..+.....--...++.-++.+|+
T Consensus 125 aI~R~dpkt~evt~f~lp~~~a~~nlet~vfD~~G~lWFt~q~G~yGrLdPa~~~i~vfpaPqG~gpyGi~atpdGsvwy 204 (353)
T COG4257 125 AIGRLDPKTLEVTRFPLPLEHADANLETAVFDPWGNLWFTGQIGAYGRLDPARNVISVFPAPQGGGPYGICATPDGSVWY 204 (353)
T ss_pred eeEEecCcccceEEeecccccCCCcccceeeCCCccEEEeeccccceecCcccCceeeeccCCCCCCcceEECCCCcEEE
Confidence 66788887776 666654444444333332220000000011122456655543222211111122234444778887
Q ss_pred EeccCCCCceeeeEEEEECCCCceeeCCCC---CCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceE
Q 014195 127 FAGYGSIDYVHSHVDIYNFTDNTWGGRFDM---PREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQ 203 (429)
Q Consensus 127 ~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~---~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~ 203 (429)
.-=. -+.+-..||.+..=+.++.. ....+|. -+---+++++. .. ....+.+|||.+..|.
T Consensus 205 asla------gnaiaridp~~~~aev~p~P~~~~~gsRri---wsdpig~~wit-----tw---g~g~l~rfdPs~~sW~ 267 (353)
T COG4257 205 ASLA------GNAIARIDPFAGHAEVVPQPNALKAGSRRI---WSDPIGRAWIT-----TW---GTGSLHRFDPSVTSWI 267 (353)
T ss_pred Eecc------ccceEEcccccCCcceecCCCccccccccc---ccCccCcEEEe-----cc---CCceeeEeCcccccce
Confidence 6211 13466777777644433211 1111111 11224567765 11 1467899999999999
Q ss_pred eCC-CCCCCCCCceEEEECCEEEEE
Q 014195 204 DLP-PLPVPRYAPATQLWRGRLHVM 227 (429)
Q Consensus 204 ~~~-~~p~~r~~~~~~~~~~~lyv~ 227 (429)
+-+ +-..+|-...-+--.+++++.
T Consensus 268 eypLPgs~arpys~rVD~~grVW~s 292 (353)
T COG4257 268 EYPLPGSKARPYSMRVDRHGRVWLS 292 (353)
T ss_pred eeeCCCCCCCcceeeeccCCcEEee
Confidence 875 333566555555556677764
No 122
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=75.76 E-value=73 Score=30.13 Aligned_cols=77 Identities=21% Similarity=0.284 Sum_probs=44.6
Q ss_pred CCEEEEEecc---CCCCceeeeEEEEECCCCc--eee-CCCCCC---CCccceeeEEEeCCEEEEEeCeeCCCCCCCCce
Q 014195 121 KNLLYVFAGY---GSIDYVHSHVDIYNFTDNT--WGG-RFDMPR---EMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAH 191 (429)
Q Consensus 121 ~~~iyv~GG~---~~~~~~~~~~~~yd~~~~~--W~~-~~~~~~---~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~ 191 (429)
+..+|+..=+ ...+.-.+-+++||.+|-+ ++. +|+-|. -..+...++...+..+||.- ..|..+
T Consensus 47 gk~~y~a~T~~sR~~rG~RtDvv~~~D~~TL~~~~EI~iP~k~R~~~~~~~~~~~ls~dgk~~~V~N-------~TPa~S 119 (342)
T PF06433_consen 47 GKTIYVAETFYSRGTRGERTDVVEIWDTQTLSPTGEIEIPPKPRAQVVPYKNMFALSADGKFLYVQN-------FTPATS 119 (342)
T ss_dssp SSEEEEEEEEEEETTEEEEEEEEEEEETTTTEEEEEEEETTS-B--BS--GGGEEE-TTSSEEEEEE-------ESSSEE
T ss_pred CCEEEEEEEEEeccccccceeEEEEEecCcCcccceEecCCcchheecccccceEEccCCcEEEEEc-------cCCCCe
Confidence 3467776543 2223345679999999985 432 332211 11233444445566778762 234778
Q ss_pred eEEEeCCCCceEe
Q 014195 192 TFVLDTETKKWQD 204 (429)
Q Consensus 192 ~~~yd~~t~~W~~ 204 (429)
|-+-|.+.++...
T Consensus 120 VtVVDl~~~kvv~ 132 (342)
T PF06433_consen 120 VTVVDLAAKKVVG 132 (342)
T ss_dssp EEEEETTTTEEEE
T ss_pred EEEEECCCCceee
Confidence 9999999998754
No 123
>PF13859 BNR_3: BNR repeat-like domain; PDB: 3B69_A.
Probab=75.67 E-value=71 Score=29.94 Aligned_cols=190 Identities=16% Similarity=0.261 Sum_probs=87.0
Q ss_pred eEEEeCCEEEEEeCee-CCC-CCCCCceeEEE-eCCCCceEeCCC-----CC---CCCCCceEEEECCEEEEEeCCCCCC
Q 014195 166 GMVTDGRYIYVVTGQY-GPQ-CRGPTAHTFVL-DTETKKWQDLPP-----LP---VPRYAPATQLWRGRLHVMGGSGENR 234 (429)
Q Consensus 166 ~~~~~~~~lyv~GG~~-~~~-~~~~~~~~~~y-d~~t~~W~~~~~-----~p---~~r~~~~~~~~~~~lyv~GG~~~~~ 234 (429)
+++-.++.|++|.... ... .......+..+ .....+|..... -. .....++.++.+++||++-|.-...
T Consensus 3 SLV~vgGvv~AvAEa~~~~~~~~~~~~ias~~~~~~g~tw~~~~~~~~~~~~~~~v~v~rPTtvvkgn~IymLvG~y~~~ 82 (310)
T PF13859_consen 3 SLVEVGGVVFAVAEAQCKKSNDSGFTDIASEYSTDNGETWKAEVAVLNDDGSKKRVDVSRPTTVVKGNKIYMLVGSYSRS 82 (310)
T ss_dssp EEEEETTEEEEEEEEESS-S-SSS-EEEEEEEESSSSSS-EEEEEE----SS-TT-EEEEEEEEEETTEEEEEEEEESS-
T ss_pred CEEEECCEEEEEEEEEEccCCCCCceeEEEeEeeccccccccceeeecccccccccccceeeeeecceeEEEEEEEEecc
Confidence 5677899999886543 211 11112223334 344567876421 11 1124566778899999886653322
Q ss_pred CCccccceEeeeecCCccccceeeccCCCCCCCc----------eeEEEeCCEE-EEEcccCCCCCCCCCCCccccccCC
Q 014195 235 YTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPH----------RACVVVDDRL-LVIGGQEGDFMAKPGSPIFKCSRRN 303 (429)
Q Consensus 235 ~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~----------~~~~~~~~~i-yv~GG~~~~~~~~~~~~~~~~~~~~ 303 (429)
. ....|.+.+..-+....+|....+++..... .++++-++.| |=+-+.+. ..
T Consensus 83 ~--~~~~~~llLvks~~~g~~W~~~~~l~~~~~~~~~~figgGGSGV~m~dGTLVFPv~a~~~---------------~~ 145 (310)
T PF13859_consen 83 A--GADDWGLLLVKSTDGGIKWGDTKSLPSTSFQSWKQFIGGGGSGVVMEDGTLVFPVQATKK---------------NG 145 (310)
T ss_dssp ---SSTTEEEEEEEEESSSSEE---EE-GGGS-EEEEEEEE-SEE-EE-TTS-EEEEEEEEET---------------T-
T ss_pred c--cccccceeeeeccCCcceeeecccCCchhccccceeecCCCCceEEcCCCEEEEEeeecc---------------Cc
Confidence 1 3456776655433445569886665543221 1111112221 11111111 11
Q ss_pred e-eeeCceEEeCCCCCeEEcCCCCCCCCCcceeEEEE-CCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEE-ecc
Q 014195 304 E-VVYDDVYMLDDEMKWKVLPSMPKPDSHIEFAWVLV-NNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHV-IGK 380 (429)
Q Consensus 304 ~-~~~~~v~~~d~~~~W~~~~~~~~~r~~~~~~~~~~-~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~-v~~ 380 (429)
+ .+.--+|.-|....|+.-..++...+. ..+++.. +++|+++.-+++.. ..+|.=.-...+|++ ++.
T Consensus 146 ~~~~SlIiYS~d~g~~W~lskg~s~~gC~-~psv~EWe~gkLlM~~~c~~g~---------rrVYeS~DmG~tWtea~gt 215 (310)
T PF13859_consen 146 DGTVSLIIYSTDDGKTWKLSKGMSPAGCS-DPSVVEWEDGKLLMMTACDDGR---------RRVYESGDMGTTWTEALGT 215 (310)
T ss_dssp --EEEEEEEESSTTSS-EE-S----TT-E-EEEEEEE-TTEEEEEEE-TTS------------EEEESSTTSS-EE-TTT
T ss_pred cceEEEEEEECCCccceEeccccCCCCcc-eEEEEeccCCeeEEEEecccce---------EEEEEEcccceehhhccCc
Confidence 1 122223333358899998777655554 4567888 88999998776542 245544445678998 445
Q ss_pred cC
Q 014195 381 LP 382 (429)
Q Consensus 381 lp 382 (429)
++
T Consensus 216 ls 217 (310)
T PF13859_consen 216 LS 217 (310)
T ss_dssp TT
T ss_pred cc
Confidence 43
No 124
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=75.38 E-value=75 Score=30.06 Aligned_cols=153 Identities=14% Similarity=0.167 Sum_probs=77.8
Q ss_pred eeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCC--ceEEEECCEEEEEeCCCCCCCCcccc
Q 014195 164 HLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYA--PATQLWRGRLHVMGGSGENRYTPEVD 240 (429)
Q Consensus 164 ~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~--~~~~~~~~~lyv~GG~~~~~~~~~~~ 240 (429)
-++++.. ++.+.+.||-+ ...+.++..+..|.- .++.-... .....+++.+.+.|+.++. +.
T Consensus 67 vFavsl~P~~~l~aTGGgD--------D~AflW~~~~ge~~~--eltgHKDSVt~~~FshdgtlLATGdmsG~-----v~ 131 (399)
T KOG0296|consen 67 VFAVSLHPNNNLVATGGGD--------DLAFLWDISTGEFAG--ELTGHKDSVTCCSFSHDGTLLATGDMSGK-----VL 131 (399)
T ss_pred eEEEEeCCCCceEEecCCC--------ceEEEEEccCCccee--EecCCCCceEEEEEccCceEEEecCCCcc-----EE
Confidence 3445544 67788888853 356678888887543 22222222 2233568888888887753 34
Q ss_pred ceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCe
Q 014195 241 HWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKW 319 (429)
Q Consensus 241 ~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W 319 (429)
+|... ....+|....++..-.. -.---...|+++|-.++. +|.|. ++..-
T Consensus 132 v~~~s-----tg~~~~~~~~e~~dieW--l~WHp~a~illAG~~DGs----------------------vWmw~ip~~~~ 182 (399)
T KOG0296|consen 132 VFKVS-----TGGEQWKLDQEVEDIEW--LKWHPRAHILLAGSTDGS----------------------VWMWQIPSQAL 182 (399)
T ss_pred EEEcc-----cCceEEEeecccCceEE--EEecccccEEEeecCCCc----------------------EEEEECCCcce
Confidence 44432 34444544311110000 000012356677765443 77776 44322
Q ss_pred EEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 320 KVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 320 ~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
.++ |+-+.....++-...+|+-.+.|-.++ .|-++||.+..
T Consensus 183 ~kv--~~Gh~~~ct~G~f~pdGKr~~tgy~dg------------ti~~Wn~ktg~ 223 (399)
T KOG0296|consen 183 CKV--MSGHNSPCTCGEFIPDGKRILTGYDDG------------TIIVWNPKTGQ 223 (399)
T ss_pred eeE--ecCCCCCcccccccCCCceEEEEecCc------------eEEEEecCCCc
Confidence 222 222223333444677777776664322 57777887763
No 125
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=75.16 E-value=38 Score=30.31 Aligned_cols=135 Identities=13% Similarity=0.111 Sum_probs=66.0
Q ss_pred CceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEe-CCCCCCCCccccceEeeeecCCccccceeeccCCCCCCC
Q 014195 189 TAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMG-GSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGP 267 (429)
Q Consensus 189 ~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~G-G~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~ 267 (429)
...|-.+|..|.+=.+--.++.+.... =+..+++|..+. | .++..|+. .+-.--+.-.||....
T Consensus 164 d~tVRLWD~rTgt~v~sL~~~s~VtSl-Evs~dG~ilTia~g-------ssV~Fwda-------ksf~~lKs~k~P~nV~ 228 (334)
T KOG0278|consen 164 DKTVRLWDHRTGTEVQSLEFNSPVTSL-EVSQDGRILTIAYG-------SSVKFWDA-------KSFGLLKSYKMPCNVE 228 (334)
T ss_pred CCceEEEEeccCcEEEEEecCCCCcce-eeccCCCEEEEecC-------ceeEEecc-------ccccceeeccCccccc
Confidence 456777787777644432333333322 123355555442 3 33555552 1111111223444332
Q ss_pred ceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEE
Q 014195 268 HRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIV 346 (429)
Q Consensus 268 ~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~ 346 (429)
. +...-+..+||.||.... +|+|| .+..=...-.-..+-.-| |.-...+|.+|..
T Consensus 229 S-ASL~P~k~~fVaGged~~----------------------~~kfDy~TgeEi~~~nkgh~gpVh-cVrFSPdGE~yAs 284 (334)
T KOG0278|consen 229 S-ASLHPKKEFFVAGGEDFK----------------------VYKFDYNTGEEIGSYNKGHFGPVH-CVRFSPDGELYAS 284 (334)
T ss_pred c-ccccCCCceEEecCcceE----------------------EEEEeccCCceeeecccCCCCceE-EEEECCCCceeec
Confidence 1 222335569999998532 67777 544322221111111121 2224578999999
Q ss_pred cccCCCCCCccceeeeCcEEEEecCC
Q 014195 347 GGTTEKHPTTKKMVLVGEIFQFNLNT 372 (429)
Q Consensus 347 GG~~~~~~~~~~~~~~~~i~~yd~~~ 372 (429)
|..++.. .+|.-.+..
T Consensus 285 GSEDGTi----------rlWQt~~~~ 300 (334)
T KOG0278|consen 285 GSEDGTI----------RLWQTTPGK 300 (334)
T ss_pred cCCCceE----------EEEEecCCC
Confidence 9887754 566666543
No 126
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=75.14 E-value=86 Score=30.61 Aligned_cols=129 Identities=9% Similarity=0.089 Sum_probs=67.5
Q ss_pred CCCceeeCCCCCCCCccceeeEEE---eCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC-C--CCCC--CCceE
Q 014195 146 TDNTWGGRFDMPREMAHSHLGMVT---DGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP-L--PVPR--YAPAT 217 (429)
Q Consensus 146 ~~~~W~~~~~~~~~~~r~~~~~~~---~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~-~--p~~r--~~~~~ 217 (429)
...+|+++. .|....+.-..+.. ..++-+++|-. ..+..=+-.-.+|+.... . ...+ ....+
T Consensus 73 ~G~~W~q~~-~p~~~~~~L~~V~F~~~d~~~GwAVG~~---------G~IL~T~DGG~tW~~~~~~~~~~~~~~~~l~~v 142 (398)
T PLN00033 73 QSSEWEQVD-LPIDPGVVLLDIAFVPDDPTHGFLLGTR---------QTLLETKDGGKTWVPRSIPSAEDEDFNYRFNSI 142 (398)
T ss_pred CCCccEEee-cCCCCCCceEEEEeccCCCCEEEEEcCC---------CEEEEEcCCCCCceECccCcccccccccceeee
Confidence 456899874 44322234555665 23578888741 223333334568988641 1 1111 23344
Q ss_pred EEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCC---CCCCCceeEEEe-CCEEEEEcccCCCCCCCCC
Q 014195 218 QLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPI---PRGGPHRACVVV-DDRLLVIGGQEGDFMAKPG 293 (429)
Q Consensus 218 ~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~---p~~~~~~~~~~~-~~~iyv~GG~~~~~~~~~~ 293 (429)
...++..|++|-.. ..+.- ...-++|+..... |... .....+ ++.++++|...
T Consensus 143 ~f~~~~g~~vG~~G--------~il~T-----~DgG~tW~~~~~~~~~p~~~--~~i~~~~~~~~~ivg~~G-------- 199 (398)
T PLN00033 143 SFKGKEGWIIGKPA--------ILLHT-----SDGGETWERIPLSPKLPGEP--VLIKATGPKSAEMVTDEG-------- 199 (398)
T ss_pred EEECCEEEEEcCce--------EEEEE-----cCCCCCceECccccCCCCCc--eEEEEECCCceEEEeccc--------
Confidence 45577888885421 11111 1345788875432 3222 233334 45577777431
Q ss_pred CCccccccCCeeeeCceEEeC-CCCCeEEc
Q 014195 294 SPIFKCSRRNEVVYDDVYMLD-DEMKWKVL 322 (429)
Q Consensus 294 ~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~ 322 (429)
.+++-+ ...+|+.+
T Consensus 200 ---------------~v~~S~D~G~tW~~~ 214 (398)
T PLN00033 200 ---------------AIYVTSNAGRNWKAA 214 (398)
T ss_pred ---------------eEEEECCCCCCceEc
Confidence 266665 67899987
No 127
>PRK02889 tolB translocation protein TolB; Provisional
Probab=75.11 E-value=88 Score=30.76 Aligned_cols=61 Identities=13% Similarity=0.199 Sum_probs=35.9
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP 207 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~ 207 (429)
.++++|..+.+=..+...+. ........-.+.+|++....++ ..++|.+|..+...+++..
T Consensus 221 ~I~~~dl~~g~~~~l~~~~g--~~~~~~~SPDG~~la~~~~~~g------~~~Iy~~d~~~~~~~~lt~ 281 (427)
T PRK02889 221 VVYVHDLATGRRRVVANFKG--SNSAPAWSPDGRTLAVALSRDG------NSQIYTVNADGSGLRRLTQ 281 (427)
T ss_pred EEEEEECCCCCEEEeecCCC--CccceEECCCCCEEEEEEccCC------CceEEEEECCCCCcEECCC
Confidence 59999998887666654433 1112222223446655433222 4689999998877766643
No 128
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=74.74 E-value=81 Score=30.16 Aligned_cols=112 Identities=6% Similarity=-0.011 Sum_probs=59.7
Q ss_pred cceeeeecCCCcccceeeeeeecCCCCe-E-EecC-CCCCCCcceeeeecC-CCCcC-------cccccccccccccCCC
Q 014195 33 ADFFWASSSKFTSSYLNIASNWSPYHNS-I-ILPN-NGPQKGENIGVKTKK-DVVPK-------RILPATFQDLPAPELK 101 (429)
Q Consensus 33 ~~~ly~~GG~~~~~~~~~~~~yd~~~~~-~-~~p~-~~~r~~~~~~~~~~~-~~~~~-------~~~~~~~~~~d~~~~~ 101 (429)
...+|+.-..+.... +.+..+|..+.+ + .+|- ..||. . +..-.+. |..+. ......+..+|..+.+
T Consensus 12 ~~~v~V~d~~~~~~~-~~v~ViD~~~~~v~g~i~~G~~P~~-~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~~ 88 (352)
T TIGR02658 12 ARRVYVLDPGHFAAT-TQVYTIDGEAGRVLGMTDGGFLPNP-V-VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTHL 88 (352)
T ss_pred CCEEEEECCcccccC-ceEEEEECCCCEEEEEEEccCCCce-e-ECCCCCEEEEEeccccccccCCCCCEEEEEECccCc
Confidence 455788776544444 899999999998 3 3343 33332 1 2222222 22111 1144677888988876
Q ss_pred eEE-ccCCCCCccC-----CcEEE-ECC-EEEEEeccCCCCceeeeEEEEECCCCceee
Q 014195 102 WEK-MKAAPVPRLD-----GAAIQ-IKN-LLYVFAGYGSIDYVHSHVDIYNFTDNTWGG 152 (429)
Q Consensus 102 W~~-~~~~p~~R~~-----~~~~~-~~~-~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~ 152 (429)
-.. ++..+.||.. ...+. -++ .+||.- .+ ..+.+-+.|..+++-..
T Consensus 89 ~~~~i~~p~~p~~~~~~~~~~~~ls~dgk~l~V~n-~~----p~~~V~VvD~~~~kvv~ 142 (352)
T TIGR02658 89 PIADIELPEGPRFLVGTYPWMTSLTPDNKTLLFYQ-FS----PSPAVGVVDLEGKAFVR 142 (352)
T ss_pred EEeEEccCCCchhhccCccceEEECCCCCEEEEec-CC----CCCEEEEEECCCCcEEE
Confidence 432 2222344522 12222 244 577752 11 13468899998887654
No 129
>smart00284 OLF Olfactomedin-like domains.
Probab=73.87 E-value=69 Score=28.98 Aligned_cols=179 Identities=13% Similarity=0.072 Sum_probs=88.3
Q ss_pred cceeeeecCCCcccceeeeeeecCC----CCe----EEecCCCCCCCcceeeeecC-CCCcCcccccccccccccCCCeE
Q 014195 33 ADFFWASSSKFTSSYLNIASNWSPY----HNS----IILPNNGPQKGENIGVKTKK-DVVPKRILPATFQDLPAPELKWE 103 (429)
Q Consensus 33 ~~~ly~~GG~~~~~~~~~~~~yd~~----~~~----~~~p~~~~r~~~~~~~~~~~-~~~~~~~~~~~~~~~d~~~~~W~ 103 (429)
++++|+.-+.. ...+.+..|... ..+ ..||. +-.+.|..+..+. +.. ..-+..+..||..+..-.
T Consensus 34 ~~~~wv~~~~~--~~~~~v~ey~~~~~f~~~~~~~~~~Lp~--~~~GtG~VVYngslYY~--~~~s~~iiKydL~t~~v~ 107 (255)
T smart00284 34 KSLYWYMPLNT--RVLRSVREYSSMSDFQMGKNPTDHPLPH--AGQGTGVVVYNGSLYFN--KFNSHDICRFDLTTETYQ 107 (255)
T ss_pred CceEEEEcccc--CCCcEEEEecCHHHHhccCCceEEECCC--ccccccEEEECceEEEE--ecCCccEEEEECCCCcEE
Confidence 46788876643 112334444321 111 33333 3345566665555 222 223467889999988765
Q ss_pred EccCCCCCc----c-----C---CcEEEECCEEEEEeccCCCCceeeeEEEEECCCC----ceeeCCCCCCCCccceeeE
Q 014195 104 KMKAAPVPR----L-----D---GAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDN----TWGGRFDMPREMAHSHLGM 167 (429)
Q Consensus 104 ~~~~~p~~R----~-----~---~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~----~W~~~~~~~~~~~r~~~~~ 167 (429)
....+|.+. . + .-.++-.+-|+|+=......... -+-..||.+- +|.. ..+. +...-+.
T Consensus 108 ~~~~Lp~a~y~~~~~Y~~~~~sdiDlAvDE~GLWvIYat~~~~g~i-vvSkLnp~tL~ve~tW~T--~~~k--~sa~naF 182 (255)
T smart00284 108 KEPLLNGAGYNNRFPYAWGGFSDIDLAVDENGLWVIYATEQNAGKI-VISKLNPATLTIENTWIT--TYNK--RSASNAF 182 (255)
T ss_pred EEEecCccccccccccccCCCccEEEEEcCCceEEEEeccCCCCCE-EEEeeCcccceEEEEEEc--CCCc--ccccccE
Confidence 444455331 1 1 12233345566653332221111 1446666644 5655 3333 2333333
Q ss_pred EEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC-CCCCCCCCceEEEE---CCEEEEE
Q 014195 168 VTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQLW---RGRLHVM 227 (429)
Q Consensus 168 ~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~~~---~~~lyv~ 227 (429)
.+ =|.||++--... ....-.+.||..+++=..+. +++.+...+++..+ +.+||+.
T Consensus 183 mv-CGvLY~~~s~~~----~~~~I~yayDt~t~~~~~~~i~f~n~y~~~s~l~YNP~d~~LY~w 241 (255)
T smart00284 183 MI-CGILYVTRSLGS----KGEKVFYAYDTNTGKEGHLDIPFENMYEYISMLDYNPNDRKLYAW 241 (255)
T ss_pred EE-eeEEEEEccCCC----CCcEEEEEEECCCCccceeeeeeccccccceeceeCCCCCeEEEE
Confidence 33 356898842111 11456788999998733322 33333444555544 5788887
No 130
>PRK02889 tolB translocation protein TolB; Provisional
Probab=71.76 E-value=1.1e+02 Score=30.20 Aligned_cols=191 Identities=10% Similarity=0.051 Sum_probs=85.7
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
..+++.|.....-..+...+. .-......-.+.+|+... ... . ...++.+|+.+.+=..+...+.. .....
T Consensus 176 ~~L~~~D~dG~~~~~l~~~~~--~v~~p~wSPDG~~la~~s-~~~-~----~~~I~~~dl~~g~~~~l~~~~g~-~~~~~ 246 (427)
T PRK02889 176 YQLQISDADGQNAQSALSSPE--PIISPAWSPDGTKLAYVS-FES-K----KPVVYVHDLATGRRRVVANFKGS-NSAPA 246 (427)
T ss_pred cEEEEECCCCCCceEeccCCC--CcccceEcCCCCEEEEEE-ccC-C----CcEEEEEECCCCCEEEeecCCCC-ccceE
Confidence 458888876655454433222 111222222344444432 211 1 35799999988865555443311 11122
Q ss_pred EEECC-EEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCc
Q 014195 218 QLWRG-RLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPI 296 (429)
Q Consensus 218 ~~~~~-~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~ 296 (429)
..-++ +|++....++ ..+.|.++ ..+...+.+.... .........-+++-+++......
T Consensus 247 ~SPDG~~la~~~~~~g-----~~~Iy~~d-----~~~~~~~~lt~~~-~~~~~~~wSpDG~~l~f~s~~~g--------- 306 (427)
T PRK02889 247 WSPDGRTLAVALSRDG-----NSQIYTVN-----ADGSGLRRLTQSS-GIDTEPFFSPDGRSIYFTSDRGG--------- 306 (427)
T ss_pred ECCCCCEEEEEEccCC-----CceEEEEE-----CCCCCcEECCCCC-CCCcCeEEcCCCCEEEEEecCCC---------
Confidence 22244 4544433222 24455543 3333333332211 11111223335553333322111
Q ss_pred cccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCe
Q 014195 297 FKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKW 375 (429)
Q Consensus 297 ~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W 375 (429)
...+|.++ .+...+.+... ....... ....+++.+++....... ..++.+|+.+...
T Consensus 307 ----------~~~Iy~~~~~~g~~~~lt~~--g~~~~~~-~~SpDG~~Ia~~s~~~g~---------~~I~v~d~~~g~~ 364 (427)
T PRK02889 307 ----------APQIYRMPASGGAAQRVTFT--GSYNTSP-RISPDGKLLAYISRVGGA---------FKLYVQDLATGQV 364 (427)
T ss_pred ----------CcEEEEEECCCCceEEEecC--CCCcCce-EECCCCCEEEEEEccCCc---------EEEEEEECCCCCe
Confidence 12478887 66666665421 1111122 234456544444332211 2689999988877
Q ss_pred EEec
Q 014195 376 HVIG 379 (429)
Q Consensus 376 ~~v~ 379 (429)
+.+.
T Consensus 365 ~~lt 368 (427)
T PRK02889 365 TALT 368 (427)
T ss_pred EEcc
Confidence 6663
No 131
>PF13088 BNR_2: BNR repeat-like domain; PDB: 2F11_A 2F0Z_A 1VCU_B 2F25_B 1SO7_A 2F29_A 1SNT_A 2F13_A 2F28_A 2F27_A ....
Probab=71.70 E-value=65 Score=29.19 Aligned_cols=221 Identities=14% Similarity=0.147 Sum_probs=99.9
Q ss_pred cCCCeEEccC---CC--CCccCCcEEEE--CCEEEEEe--ccCCCC-ceeeeEEEEECC-CCceeeCCCCCCC------C
Q 014195 98 PELKWEKMKA---AP--VPRLDGAAIQI--KNLLYVFA--GYGSID-YVHSHVDIYNFT-DNTWGGRFDMPRE------M 160 (429)
Q Consensus 98 ~~~~W~~~~~---~p--~~R~~~~~~~~--~~~iyv~G--G~~~~~-~~~~~~~~yd~~-~~~W~~~~~~~~~------~ 160 (429)
...+|..... .+ ..+....+.+. +++|+++- +..... ....-.+..... ..+|+....++.. .
T Consensus 28 ~G~tWs~~~~v~~~~~~~~~~~~p~~~~~~~g~l~l~~~~~~~~~~~~~~~~~~~~S~D~G~TWs~~~~l~~~~~~~~~~ 107 (275)
T PF13088_consen 28 GGKTWSEPRIVADGPKPGRRYGNPSLVVDPDGRLWLFYSAGSSGGGWSGSRIYYSRSTDGGKTWSEPTDLPPGWFGNFSG 107 (275)
T ss_dssp CTTEEEEEEEEETSTBTTCEEEEEEEEEETTSEEEEEEEEEETTESCCTCEEEEEEESSTTSS-EEEEEEHHHCCCSCEE
T ss_pred CCCeeCCCEEEeeccccCCcccCcEEEEeCCCCEEEEEEEccCCCCCCceeEEEEEECCCCCCCCCccccccccccceec
Confidence 4457977433 23 12223323332 77888876 322221 111111244444 4689876443221 0
Q ss_pred ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCC-CCceEeCCCCC-CCCCCceE-EEE-CCEEEEEeCCCCCCCC
Q 014195 161 AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTE-TKKWQDLPPLP-VPRYAPAT-QLW-RGRLHVMGGSGENRYT 236 (429)
Q Consensus 161 ~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~-t~~W~~~~~~p-~~r~~~~~-~~~-~~~lyv~GG~~~~~~~ 236 (429)
+-....+...++.+++. .+..... .......|... -.+|+.....+ .......+ +.. +++|+++--.....
T Consensus 108 ~~~~~~i~~~~G~l~~~-~~~~~~~--~~~~~~~~S~D~G~tW~~~~~~~~~~~~~e~~~~~~~dG~l~~~~R~~~~~-- 182 (275)
T PF13088_consen 108 PGRGPPIQLPDGRLIAP-YYHESGG--SFSAFVYYSDDGGKTWSSGSPIPDGQGECEPSIVELPDGRLLAVFRTEGND-- 182 (275)
T ss_dssp CSEEEEEEECTTEEEEE-EEEESSC--EEEEEEEEESSTTSSEEEEEECECSEEEEEEEEEEETTSEEEEEEEECSST--
T ss_pred cceeeeeEecCCCEEEE-Eeecccc--CcceEEEEeCCCCceeeccccccccCCcceeEEEECCCCcEEEEEEccCCC--
Confidence 11122245558888887 2222111 12334445444 45699887653 22333333 333 67888885432111
Q ss_pred ccccceEeeeecCCccccceeecc--CCCCCCCceeEEE-eCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEe
Q 014195 237 PEVDHWSLAVKDGKPLEKEWRTEI--PIPRGGPHRACVV-VDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYML 313 (429)
Q Consensus 237 ~~~~~~~~~~~~~d~~~~~W~~~~--~~p~~~~~~~~~~-~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~ 313 (429)
..+.. .. ...-.+|+... .+|.......++. -+++++++....... ..+.-.+..
T Consensus 183 ---~~~~~--~S-~D~G~TWs~~~~~~~~~~~~~~~~~~~~~g~~~~~~~~~~~r----------------~~l~l~~S~ 240 (275)
T PF13088_consen 183 ---DIYIS--RS-TDGGRTWSPPQPTNLPNPNSSISLVRLSDGRLLLVYNNPDGR----------------SNLSLYVSE 240 (275)
T ss_dssp ---EEEEE--EE-SSTTSS-EEEEEEECSSCCEEEEEEECTTSEEEEEEECSSTS----------------EEEEEEEEC
T ss_pred ---cEEEE--EE-CCCCCcCCCceecccCcccCCceEEEcCCCCEEEEEECCCCC----------------CceEEEEEe
Confidence 11111 11 23466898754 3444443333333 367888777732111 011112233
Q ss_pred CCCCCeEEcCCCCCCC---CCcceeEEEECCEEEE
Q 014195 314 DDEMKWKVLPSMPKPD---SHIEFAWVLVNNSIVI 345 (429)
Q Consensus 314 d~~~~W~~~~~~~~~r---~~~~~~~~~~~~~i~v 345 (429)
|...+|+....+.... ....+.+..-+++|+|
T Consensus 241 D~g~tW~~~~~i~~~~~~~~~Y~~~~~~~dg~l~i 275 (275)
T PF13088_consen 241 DGGKTWSRPKTIDDGPNGDSGYPSLTQLPDGKLYI 275 (275)
T ss_dssp TTCEEEEEEEEEEEEE-CCEEEEEEEEEETTEEEE
T ss_pred CCCCcCCccEEEeCCCCCcEECCeeEEeCCCcCCC
Confidence 3688999765442222 3333333444678886
No 132
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=71.54 E-value=1.1e+02 Score=30.40 Aligned_cols=213 Identities=13% Similarity=0.187 Sum_probs=103.7
Q ss_pred ECCEEEEEeccCCCCceeeeEEEEECCCCceeeC-------CCCCCCCccceeeEEEe-------CCEEEEEeCeeCCCC
Q 014195 120 IKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGR-------FDMPREMAHSHLGMVTD-------GRYIYVVTGQYGPQC 185 (429)
Q Consensus 120 ~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~-------~~~~~~~~r~~~~~~~~-------~~~lyv~GG~~~~~~ 185 (429)
.++.|+|+-|.. ..-+||-...+|... -+|.. .-+|.+.+. +...|+.-+.++.
T Consensus 225 Tg~~iLvvsg~a-------qakl~DRdG~~~~e~~KGDQYI~Dm~n---TKGHia~lt~g~whP~~k~~FlT~s~Dgt-- 292 (641)
T KOG0772|consen 225 TGDQILVVSGSA-------QAKLLDRDGFEIVEFSKGDQYIRDMYN---TKGHIAELTCGCWHPDNKEEFLTCSYDGT-- 292 (641)
T ss_pred CCCeEEEEecCc-------ceeEEccCCceeeeeeccchhhhhhhc---cCCceeeeeccccccCcccceEEecCCCc--
Confidence 378888888753 345677666666542 23332 122332222 2345555554331
Q ss_pred CCCCceeEEEeCCCCceEeCC--CCCCCCCCceEEEE--CCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccC
Q 014195 186 RGPTAHTFVLDTETKKWQDLP--PLPVPRYAPATQLW--RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIP 261 (429)
Q Consensus 186 ~~~~~~~~~yd~~t~~W~~~~--~~p~~r~~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~ 261 (429)
-.+|-.+-...+-+-+. ++...|...+.|.+ ++++ |.+|+.. .++..|+. ..|..-+.
T Consensus 293 ----lRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~-iAagc~D----GSIQ~W~~---------~~~~v~p~ 354 (641)
T KOG0772|consen 293 ----LRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKL-IAAGCLD----GSIQIWDK---------GSRTVRPV 354 (641)
T ss_pred ----EEEEecCCchhheeEEeeccCCCcccCceeeecCCCcch-hhhcccC----Cceeeeec---------CCcccccc
Confidence 12222211111111121 33456666777766 4566 6666543 35777762 33443222
Q ss_pred C-------CCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC----CCCCeEEcCCCCCCCC
Q 014195 262 I-------PRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD----DEMKWKVLPSMPKPDS 330 (429)
Q Consensus 262 ~-------p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d----~~~~W~~~~~~~~~r~ 330 (429)
+ +...........++++++-=|.+.. -.+|.+. .-+.|+-++.+ ..
T Consensus 355 ~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~t--------------------LKvWDLrq~kkpL~~~tgL~t~---~~ 411 (641)
T KOG0772|consen 355 MKVKDAHLPGQDITSISFSYDGNYLLSRGFDDT--------------------LKVWDLRQFKKPLNVRTGLPTP---FP 411 (641)
T ss_pred eEeeeccCCCCceeEEEeccccchhhhccCCCc--------------------eeeeeccccccchhhhcCCCcc---CC
Confidence 2 2222212333457777776665432 1366664 23466666543 22
Q ss_pred CcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceeeeeeEEEC
Q 014195 331 HIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGYWN 394 (429)
Q Consensus 331 ~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~~ 394 (429)
...| +...+.+|++.|-.-.+.. -...+++||..+ ...+..++..-+....+.+.
T Consensus 412 ~tdc-~FSPd~kli~TGtS~~~~~------~~g~L~f~d~~t--~d~v~ki~i~~aSvv~~~Wh 466 (641)
T KOG0772|consen 412 GTDC-CFSPDDKLILTGTSAPNGM------TAGTLFFFDRMT--LDTVYKIDISTASVVRCLWH 466 (641)
T ss_pred CCcc-ccCCCceEEEecccccCCC------CCceEEEEeccc--eeeEEEecCCCceEEEEeec
Confidence 2223 3677889888886544332 123688887544 44454555443333333333
No 133
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=71.05 E-value=1.4e+02 Score=31.28 Aligned_cols=137 Identities=9% Similarity=0.083 Sum_probs=71.9
Q ss_pred hcceeeeecCCCcccceeeeeeecCCCCeEEecCCCCCCCc-ceeeeecCCCCcCcccccccccccccCCCeEEccCCCC
Q 014195 32 VADFFWASSSKFTSSYLNIASNWSPYHNSIILPNNGPQKGE-NIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKAAPV 110 (429)
Q Consensus 32 ~~~~ly~~GG~~~~~~~~~~~~yd~~~~~~~~p~~~~r~~~-~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~ 110 (429)
-++.+.+.|+.|+ .+-.||....-.-+.-..+-+++ ++.........-...+...+-.+|....+=-+--..|.
T Consensus 360 pDgq~iaTG~eDg-----KVKvWn~~SgfC~vTFteHts~Vt~v~f~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P~ 434 (893)
T KOG0291|consen 360 PDGQLIATGAEDG-----KVKVWNTQSGFCFVTFTEHTSGVTAVQFTARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSPE 434 (893)
T ss_pred CCCcEEEeccCCC-----cEEEEeccCceEEEEeccCCCceEEEEEEecCCEEEEeecCCeEEeeeecccceeeeecCCC
Confidence 4667888888777 56677766554223223333332 33333333333333344555555554332111111233
Q ss_pred CccCCcEEEEC--CEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCee
Q 014195 111 PRLDGAAIQIK--NLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQY 181 (429)
Q Consensus 111 ~R~~~~~~~~~--~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~ 181 (429)
|..++++.++ +.|.++|+.+. . ++++++.+|++-..+=.-.+. |-.+.++...++ +.+.|-++
T Consensus 435 -p~QfscvavD~sGelV~AG~~d~----F-~IfvWS~qTGqllDiLsGHEg-PVs~l~f~~~~~-~LaS~SWD 499 (893)
T KOG0291|consen 435 -PIQFSCVAVDPSGELVCAGAQDS----F-EIFVWSVQTGQLLDILSGHEG-PVSGLSFSPDGS-LLASGSWD 499 (893)
T ss_pred -ceeeeEEEEcCCCCEEEeeccce----E-EEEEEEeecCeeeehhcCCCC-cceeeEEccccC-eEEecccc
Confidence 4566777776 88999987653 2 388889888876554222221 333444444455 55555543
No 134
>PF15525 DUF4652: Domain of unknown function (DUF4652)
Probab=71.00 E-value=64 Score=27.54 Aligned_cols=88 Identities=11% Similarity=0.049 Sum_probs=52.2
Q ss_pred ccCCCCceeeeEEEEECCCCceeeC--CCCC-CCCccceeeEEEeCCEEEE-EeCeeCCCCCCCCceeEEEeCCCCceEe
Q 014195 129 GYGSIDYVHSHVDIYNFTDNTWGGR--FDMP-REMAHSHLGMVTDGRYIYV-VTGQYGPQCRGPTAHTFVLDTETKKWQD 204 (429)
Q Consensus 129 G~~~~~~~~~~~~~yd~~~~~W~~~--~~~~-~~~~r~~~~~~~~~~~lyv-~GG~~~~~~~~~~~~~~~yd~~t~~W~~ 204 (429)
|.++.......++++|..++.|..+ .+.+ .-.|. ...-+.+..|.| +|-..+.-.. -..+++|++.++.-+.
T Consensus 79 g~~a~eEgiGkIYIkn~~~~~~~~L~i~~~~~k~sPK--~i~WiDD~~L~vIIG~a~GTvS~--GGnLy~~nl~tg~~~~ 154 (200)
T PF15525_consen 79 GPEAEEEGIGKIYIKNLNNNNWWSLQIDQNEEKYSPK--YIEWIDDNNLAVIIGYAHGTVSK--GGNLYKYNLNTGNLTE 154 (200)
T ss_pred CCccccccceeEEEEecCCCceEEEEecCcccccCCc--eeEEecCCcEEEEEccccceEcc--CCeEEEEEccCCceeE
Confidence 3444445567899999999998754 3332 11233 333344555554 4533332211 4589999999999998
Q ss_pred CCCCCCCCCCceEEEE
Q 014195 205 LPPLPVPRYAPATQLW 220 (429)
Q Consensus 205 ~~~~p~~r~~~~~~~~ 220 (429)
+-+...-+.....+..
T Consensus 155 ly~~~dkkqQVis~e~ 170 (200)
T PF15525_consen 155 LYEWKDKKQQVISAEK 170 (200)
T ss_pred eeeccccceeEEEEEE
Confidence 8776554444334443
No 135
>PF14583 Pectate_lyase22: Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=70.74 E-value=31 Score=33.16 Aligned_cols=80 Identities=14% Similarity=0.050 Sum_probs=40.5
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
+++-++|++.-.. ...++..|+.+.+-+++.+.+.. ...+..++..++.+|.+-. ...++..|++|.
T Consensus 46 dG~kllF~s~~dg---~~nly~lDL~t~~i~QLTdg~g~-~~~g~~~s~~~~~~~Yv~~---------~~~l~~vdL~T~ 112 (386)
T PF14583_consen 46 DGRKLLFASDFDG---NRNLYLLDLATGEITQLTDGPGD-NTFGGFLSPDDRALYYVKN---------GRSLRRVDLDTL 112 (386)
T ss_dssp TS-EEEEEE-TTS---S-EEEEEETTT-EEEE---SS-B--TTT-EE-TTSSEEEEEET---------TTEEEEEETTT-
T ss_pred CCCEEEEEeccCC---CcceEEEEcccCEEEECccCCCC-CccceEEecCCCeEEEEEC---------CCeEEEEECCcC
Confidence 4545555554222 23489999999999999887641 2334444445667655521 347888899888
Q ss_pred ceEeCCCCCCCCC
Q 014195 201 KWQDLPPLPVPRY 213 (429)
Q Consensus 201 ~W~~~~~~p~~r~ 213 (429)
+=+.+-..|..-.
T Consensus 113 e~~~vy~~p~~~~ 125 (386)
T PF14583_consen 113 EERVVYEVPDDWK 125 (386)
T ss_dssp -EEEEEE--TTEE
T ss_pred cEEEEEECCcccc
Confidence 7666655554433
No 136
>PRK03629 tolB translocation protein TolB; Provisional
Probab=68.68 E-value=1.2e+02 Score=29.76 Aligned_cols=186 Identities=11% Similarity=0.047 Sum_probs=89.9
Q ss_pred eeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceE
Q 014195 138 SHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPAT 217 (429)
Q Consensus 138 ~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~ 217 (429)
..++++|..+++-+.+...+.. -......-.+.+|++.....+ ..+++.+|..+.+.+++..-..... ...
T Consensus 223 ~~i~i~dl~~G~~~~l~~~~~~--~~~~~~SPDG~~La~~~~~~g------~~~I~~~d~~tg~~~~lt~~~~~~~-~~~ 293 (429)
T PRK03629 223 SALVIQTLANGAVRQVASFPRH--NGAPAFSPDGSKLAFALSKTG------SLNLYVMDLASGQIRQVTDGRSNNT-EPT 293 (429)
T ss_pred cEEEEEECCCCCeEEccCCCCC--cCCeEECCCCCEEEEEEcCCC------CcEEEEEECCCCCEEEccCCCCCcC-ceE
Confidence 3589999988887777655441 112222233456665533211 3579999999988887754332111 111
Q ss_pred EEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCcc
Q 014195 218 QLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIF 297 (429)
Q Consensus 218 ~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~ 297 (429)
..-+++.+++..... ...+.|.+. ..+..-+.+..... ........-+++.+++.+....
T Consensus 294 wSPDG~~I~f~s~~~----g~~~Iy~~d-----~~~g~~~~lt~~~~-~~~~~~~SpDG~~Ia~~~~~~g---------- 353 (429)
T PRK03629 294 WFPDSQNLAYTSDQA----GRPQVYKVN-----INGGAPQRITWEGS-QNQDADVSSDGKFMVMVSSNGG---------- 353 (429)
T ss_pred ECCCCCEEEEEeCCC----CCceEEEEE-----CCCCCeEEeecCCC-CccCEEECCCCCEEEEEEccCC----------
Confidence 222444333332211 112444432 33433333321111 1111222335554444332211
Q ss_pred ccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCC
Q 014195 298 KCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLK 374 (429)
Q Consensus 298 ~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~ 374 (429)
..+++.+| .+..++.+.... ..... ....|++.+++.+..... ..++..+.+...
T Consensus 354 ---------~~~I~~~dl~~g~~~~Lt~~~---~~~~p-~~SpDG~~i~~~s~~~~~---------~~l~~~~~~G~~ 409 (429)
T PRK03629 354 ---------QQHIAKQDLATGGVQVLTDTF---LDETP-SIAPNGTMVIYSSSQGMG---------SVLNLVSTDGRF 409 (429)
T ss_pred ---------CceEEEEECCCCCeEEeCCCC---CCCCc-eECCCCCEEEEEEcCCCc---------eEEEEEECCCCC
Confidence 11477788 777888776421 11122 245678777777654332 246666665443
No 137
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=67.79 E-value=1.2e+02 Score=29.40 Aligned_cols=121 Identities=12% Similarity=0.202 Sum_probs=62.8
Q ss_pred eeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEE-CCEEEEEeCCCCCCCCccccc
Q 014195 164 HLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLW-RGRLHVMGGSGENRYTPEVDH 241 (429)
Q Consensus 164 ~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~ 241 (429)
.++++++ ++.||..|-. ...+-.||++... .++..|.--.--..+.+ +|-.|+.-+.+. .++..
T Consensus 350 ~ts~~fHpDgLifgtgt~--------d~~vkiwdlks~~--~~a~Fpght~~vk~i~FsENGY~Lat~add----~~V~l 415 (506)
T KOG0289|consen 350 YTSAAFHPDGLIFGTGTP--------DGVVKIWDLKSQT--NVAKFPGHTGPVKAISFSENGYWLATAADD----GSVKL 415 (506)
T ss_pred eEEeeEcCCceEEeccCC--------CceEEEEEcCCcc--ccccCCCCCCceeEEEeccCceEEEEEecC----CeEEE
Confidence 4555555 5556655432 3467788888876 55555542222222333 333444434332 23778
Q ss_pred eEeeeecCCccccceeeccCCCCCCCceeEEEe--CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCC
Q 014195 242 WSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVV--DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMK 318 (429)
Q Consensus 242 ~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~--~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~ 318 (429)
|++. +....+.. +++... ......+ .|+.++++|.+- .||.++ .+..
T Consensus 416 wDLR------Kl~n~kt~-~l~~~~-~v~s~~fD~SGt~L~~~g~~l----------------------~Vy~~~k~~k~ 465 (506)
T KOG0289|consen 416 WDLR------KLKNFKTI-QLDEKK-EVNSLSFDQSGTYLGIAGSDL----------------------QVYICKKKTKS 465 (506)
T ss_pred EEeh------hhccccee-eccccc-cceeEEEcCCCCeEEeeccee----------------------EEEEEeccccc
Confidence 8863 11111111 112211 2233344 455777776531 378888 8999
Q ss_pred eEEcCCCCCC
Q 014195 319 WKVLPSMPKP 328 (429)
Q Consensus 319 W~~~~~~~~~ 328 (429)
|+.+..++.-
T Consensus 466 W~~~~~~~~~ 475 (506)
T KOG0289|consen 466 WTEIKELADH 475 (506)
T ss_pred ceeeehhhhc
Confidence 9999876543
No 138
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=67.40 E-value=12 Score=34.88 Aligned_cols=180 Identities=9% Similarity=0.064 Sum_probs=99.1
Q ss_pred hcceeeeecCCCcccceeeeeeecCCCCe-EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccC---
Q 014195 32 VADFFWASSSKFTSSYLNIASNWSPYHNS-IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKA--- 107 (429)
Q Consensus 32 ~~~~ly~~GG~~~~~~~~~~~~yd~~~~~-~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~--- 107 (429)
+++.+.+.|..+. ++-.||-.|.. +..--.....-+++....+.-..|.+..+.+++..+.++. ++-
T Consensus 245 yd~rviisGSSDs-----TvrvWDv~tge~l~tlihHceaVLhlrf~ng~mvtcSkDrsiaVWdm~sps~----it~rrV 315 (499)
T KOG0281|consen 245 YDERVIVSGSSDS-----TVRVWDVNTGEPLNTLIHHCEAVLHLRFSNGYMVTCSKDRSIAVWDMASPTD----ITLRRV 315 (499)
T ss_pred ccceEEEecCCCc-----eEEEEeccCCchhhHHhhhcceeEEEEEeCCEEEEecCCceeEEEeccCchH----HHHHHH
Confidence 5667777776544 67888887776 2221111222233333333345566655555555544431 111
Q ss_pred CCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCC
Q 014195 108 APVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRG 187 (429)
Q Consensus 108 ~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~ 187 (429)
+-..|+..-++-++++ ||+.-.. ...+.+++..|.+.... +.. .+.+-+++-+.+++.|.|-.
T Consensus 316 LvGHrAaVNvVdfd~k-yIVsASg-----DRTikvW~~st~efvRt--l~g--HkRGIAClQYr~rlvVSGSS------- 378 (499)
T KOG0281|consen 316 LVGHRAAVNVVDFDDK-YIVSASG-----DRTIKVWSTSTCEFVRT--LNG--HKRGIACLQYRDRLVVSGSS------- 378 (499)
T ss_pred Hhhhhhheeeeccccc-eEEEecC-----CceEEEEeccceeeehh--hhc--ccccceehhccCeEEEecCC-------
Confidence 1223444444555777 4433221 23467788777766543 333 23466777788988887643
Q ss_pred CCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEee
Q 014195 188 PTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLA 245 (429)
Q Consensus 188 ~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~ 245 (429)
.+.+-.||.+.+.--++-.-.. -.-.++-++++-.|.||+++ .+.+|++.
T Consensus 379 -DntIRlwdi~~G~cLRvLeGHE--eLvRciRFd~krIVSGaYDG-----kikvWdl~ 428 (499)
T KOG0281|consen 379 -DNTIRLWDIECGACLRVLEGHE--ELVRCIRFDNKRIVSGAYDG-----KIKVWDLQ 428 (499)
T ss_pred -CceEEEEeccccHHHHHHhchH--HhhhheeecCceeeeccccc-----eEEEEecc
Confidence 4566778887766544321100 11234567899999999764 57888863
No 139
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=65.65 E-value=1.3e+02 Score=28.66 Aligned_cols=169 Identities=14% Similarity=0.181 Sum_probs=78.1
Q ss_pred eeeEEEe--CCEEEEEeCeeCCCCCCCCceeEEEeCCCCc--eEeCCC--CCCCCCCceEEEE--CCEEEEEeCCCCCCC
Q 014195 164 HLGMVTD--GRYIYVVTGQYGPQCRGPTAHTFVLDTETKK--WQDLPP--LPVPRYAPATQLW--RGRLHVMGGSGENRY 235 (429)
Q Consensus 164 ~~~~~~~--~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~--W~~~~~--~p~~r~~~~~~~~--~~~lyv~GG~~~~~~ 235 (429)
.|.+... ++.+|+.- - + ...++.|+..... ...... +|..-.-..++.. +..+||+.-..
T Consensus 146 ~H~v~~~pdg~~v~v~d---l-G----~D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s---- 213 (345)
T PF10282_consen 146 PHQVVFSPDGRFVYVPD---L-G----ADRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELS---- 213 (345)
T ss_dssp EEEEEE-TTSSEEEEEE---T-T----TTEEEEEEE-TTS-TEEEEEEEECSTTSSEEEEEE-TTSSEEEEEETTT----
T ss_pred ceeEEECCCCCEEEEEe---c-C----CCEEEEEEEeCCCceEEEeeccccccCCCCcEEEEcCCcCEEEEecCCC----
Confidence 4555544 45777762 1 1 5678888887665 554332 2221111123332 35799996543
Q ss_pred CccccceEeeeecCCccccceee---ccCCCCC---C-CceeEEEe--CCEEEEEcccCCCCCCCCCCCccccccCCeee
Q 014195 236 TPEVDHWSLAVKDGKPLEKEWRT---EIPIPRG---G-PHRACVVV--DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVV 306 (429)
Q Consensus 236 ~~~~~~~~~~~~~~d~~~~~W~~---~~~~p~~---~-~~~~~~~~--~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~ 306 (429)
..+..+++. +.+..++. ...+|.. . ..+.+++. +..||+.--...
T Consensus 214 -~~v~v~~~~-----~~~g~~~~~~~~~~~~~~~~~~~~~~~i~ispdg~~lyvsnr~~~-------------------- 267 (345)
T PF10282_consen 214 -NTVSVFDYD-----PSDGSLTEIQTISTLPEGFTGENAPAEIAISPDGRFLYVSNRGSN-------------------- 267 (345)
T ss_dssp -TEEEEEEEE-----TTTTEEEEEEEEESCETTSCSSSSEEEEEE-TTSSEEEEEECTTT--------------------
T ss_pred -CcEEEEeec-----ccCCceeEEEEeeeccccccccCCceeEEEecCCCEEEEEeccCC--------------------
Confidence 445555543 34444443 3333322 1 22233333 344777553221
Q ss_pred eCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEec
Q 014195 307 YDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIG 379 (429)
Q Consensus 307 ~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~ 379 (429)
.-.+|..| .+.+.+.+...+..-.....-.+..+++.++++...+..- .++..|+++..++.+.
T Consensus 268 sI~vf~~d~~~g~l~~~~~~~~~G~~Pr~~~~s~~g~~l~Va~~~s~~v---------~vf~~d~~tG~l~~~~ 332 (345)
T PF10282_consen 268 SISVFDLDPATGTLTLVQTVPTGGKFPRHFAFSPDGRYLYVANQDSNTV---------SVFDIDPDTGKLTPVG 332 (345)
T ss_dssp EEEEEEECTTTTTEEEEEEEEESSSSEEEEEE-TTSSEEEEEETTTTEE---------EEEEEETTTTEEEEEE
T ss_pred EEEEEEEecCCCceEEEEEEeCCCCCccEEEEeCCCCEEEEEecCCCeE---------EEEEEeCCCCcEEEec
Confidence 11356665 5556666554332111111111334555555554443221 3445567788888775
No 140
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=65.53 E-value=1.3e+02 Score=28.83 Aligned_cols=215 Identities=17% Similarity=0.213 Sum_probs=103.9
Q ss_pred ccccccccCCC--eEEccCCCCCccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCC--ceeeCCCCCCCCccceee
Q 014195 91 TFQDLPAPELK--WEKMKAAPVPRLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDN--TWGGRFDMPREMAHSHLG 166 (429)
Q Consensus 91 ~~~~~d~~~~~--W~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~--~W~~~~~~~~~~~r~~~~ 166 (429)
.+..+|+.+.+ |.....-...........-+++||+- ..++ .+++||..+. .|..-.+. . .+..-.
T Consensus 79 ~i~A~d~~~g~~~W~~~~~~~~~~~~~~~~~~~G~i~~g-~~~g------~~y~ld~~~G~~~W~~~~~~-~--~~~~~~ 148 (370)
T COG1520 79 NIFALNPDTGLVKWSYPLLGAVAQLSGPILGSDGKIYVG-SWDG------KLYALDASTGTLVWSRNVGG-S--PYYASP 148 (370)
T ss_pred cEEEEeCCCCcEEecccCcCcceeccCceEEeCCeEEEe-cccc------eEEEEECCCCcEEEEEecCC-C--eEEecC
Confidence 56777887775 85533210111112222236776664 3333 5899999644 58764333 1 344445
Q ss_pred EEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC--ceEeCCCC-CCCCCCceEEEECCEEEEEeCCCCCCCCccccceE
Q 014195 167 MVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK--KWQDLPPL-PVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWS 243 (429)
Q Consensus 167 ~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~--~W~~~~~~-p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~ 243 (429)
.++.++.+|+.- ....++++|.++. .|+.-.+. ...+.....+..++.+|+-.-. + +...|.
T Consensus 149 ~v~~~~~v~~~s---------~~g~~~al~~~tG~~~W~~~~~~~~~~~~~~~~~~~~~~vy~~~~~----~--~~~~~a 213 (370)
T COG1520 149 PVVGDGTVYVGT---------DDGHLYALNADTGTLKWTYETPAPLSLSIYGSPAIASGTVYVGSDG----Y--DGILYA 213 (370)
T ss_pred cEEcCcEEEEec---------CCCeEEEEEccCCcEEEEEecCCccccccccCceeecceEEEecCC----C--cceEEE
Confidence 566677777652 1467888888854 58854332 2333333333556666665321 1 113444
Q ss_pred eeeecCCccccceeeccCCCCCCCce--eEEEeCCEEEEEccc-CCCCCCCCCCCccccccCCeeeeCceEEeC-C--CC
Q 014195 244 LAVKDGKPLEKEWRTEIPIPRGGPHR--ACVVVDDRLLVIGGQ-EGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-D--EM 317 (429)
Q Consensus 244 ~~~~~~d~~~~~W~~~~~~p~~~~~~--~~~~~~~~iyv~GG~-~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~--~~ 317 (429)
++.. ..+..|+.....+..+... ......+.||+-++. ... ....++++| . +.
T Consensus 214 ~~~~---~G~~~w~~~~~~~~~~~~~~~~~~~~~~~v~v~~~~~~~~------------------~~g~~~~l~~~~G~~ 272 (370)
T COG1520 214 LNAE---DGTLKWSQKVSQTIGRTAISTTPAVDGGPVYVDGGVYAGS------------------YGGKLLCLDADTGEL 272 (370)
T ss_pred EEcc---CCcEeeeeeeecccCcccccccccccCceEEECCcEEEEe------------------cCCeEEEEEcCCCce
Confidence 3311 2355687533222222110 223444555555541 111 111367776 3 56
Q ss_pred CeEEcCCCCCCCCC-cceeEEEECCEEEEEcccCC
Q 014195 318 KWKVLPSMPKPDSH-IEFAWVLVNNSIVIVGGTTE 351 (429)
Q Consensus 318 ~W~~~~~~~~~r~~-~~~~~~~~~~~i~v~GG~~~ 351 (429)
.|+.-..+...-.. ..+....-++++|+......
T Consensus 273 ~W~~~~~~~~~~~~~~~~~~~~~dG~v~~~~~~~~ 307 (370)
T COG1520 273 IWSFPAGGSVQGSGLYTTPVAGADGKVYIGFTDND 307 (370)
T ss_pred EEEEecccEeccCCeeEEeecCCCccEEEEEeccc
Confidence 78876542222111 11112223778888765443
No 141
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=65.24 E-value=1e+02 Score=27.59 Aligned_cols=18 Identities=22% Similarity=0.566 Sum_probs=11.8
Q ss_pred cEEEEecCCC-CeEEeccc
Q 014195 364 EIFQFNLNTL-KWHVIGKL 381 (429)
Q Consensus 364 ~i~~yd~~~~-~W~~v~~l 381 (429)
.+.++-+..+ +|.+++..
T Consensus 279 kvtlwke~~~Gkw~~v~~~ 297 (299)
T KOG1332|consen 279 KVTLWKENVDGKWEEVGEV 297 (299)
T ss_pred EEEEEEeCCCCcEEEcccc
Confidence 4666666554 99988643
No 142
>PLN03215 ascorbic acid mannose pathway regulator 1; Provisional
Probab=64.68 E-value=1.4e+02 Score=28.82 Aligned_cols=102 Identities=7% Similarity=0.022 Sum_probs=57.9
Q ss_pred CCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCC-----CCCC--CCCceEEE
Q 014195 147 DNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPP-----LPVP--RYAPATQL 219 (429)
Q Consensus 147 ~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~-----~p~~--r~~~~~~~ 219 (429)
.+.|+.+..+. ...--++..+|++|++.- ...++.++.+- +-.++.+ +... +...-.+.
T Consensus 189 ~~~Wt~l~~~~----~~~~DIi~~kGkfYAvD~---------~G~l~~i~~~l-~i~~v~~~i~~~~~~g~~~~~~yLVE 254 (373)
T PLN03215 189 GNVLKALKQMG----YHFSDIIVHKGQTYALDS---------IGIVYWINSDL-EFSRFGTSLDENITDGCWTGDRRFVE 254 (373)
T ss_pred CCeeeEccCCC----ceeeEEEEECCEEEEEcC---------CCeEEEEecCC-ceeeecceecccccCCcccCceeEEE
Confidence 48999996432 335678889999999821 24566666331 1122221 1111 12234667
Q ss_pred ECCEEEEEeCCCCCCCC-------ccccceEeeeecCCccccceeeccCC
Q 014195 220 WRGRLHVMGGSGENRYT-------PEVDHWSLAVKDGKPLEKEWRTEIPI 262 (429)
Q Consensus 220 ~~~~lyv~GG~~~~~~~-------~~~~~~~~~~~~~d~~~~~W~~~~~~ 262 (429)
..|+|+++......... .......+.++..|.+..+|.++..+
T Consensus 255 s~GdLLmV~R~~~~~~~~~~~~~~~~~~t~~f~VfklD~~~~~WveV~sL 304 (373)
T PLN03215 255 CCGELYIVERLPKESTWKRKADGFEYSRTVGFKVYKFDDELAKWMEVKTL 304 (373)
T ss_pred ECCEEEEEEEEccCcccccccccccccceeEEEEEEEcCCCCcEEEeccc
Confidence 78899999874221100 01123455666667888888886665
No 143
>TIGR03075 PQQ_enz_alc_DH PQQ-dependent dehydrogenase, methanol/ethanol family. This protein family has a phylogenetic distribution very similar to that coenzyme PQQ biosynthesis enzymes, as shown by partial phylogenetic profiling. Genes in this family often are found adjacent to the PQQ biosynthesis genes themselves. An unusual, strained disulfide bond between adjacent Cys residues contributes to PQQ-binding, as does a Trp residue that is part of a PQQ enzyme repeat (see pfam01011). Characterized members include the dehydrogenase subunit of a membrane-anchored, three subunit alcohol (ethanol) dehydrogenase of Gluconobacter suboxydans, a homodimeric ethanol dehydrogenase in Pseudomonas aeruginosa, and the large subunit of an alpha2/beta2 heterotetrameric methanol dehydrogenase in Methylobacterium extorquens.
Probab=63.37 E-value=1e+02 Score=31.37 Aligned_cols=60 Identities=18% Similarity=0.226 Sum_probs=31.1
Q ss_pred eEEeC-C--CCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC--CeE
Q 014195 310 VYMLD-D--EMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL--KWH 376 (429)
Q Consensus 310 v~~~d-~--~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~--~W~ 376 (429)
++.+| . +..|+.-..-.........+-++.+++||+-....+.. ....+..||.++. .|+
T Consensus 132 l~ALDa~TGk~~W~~~~~~~~~~~~~tssP~v~~g~Vivg~~~~~~~-------~~G~v~AlD~~TG~~lW~ 196 (527)
T TIGR03075 132 LVALDAKTGKVVWSKKNGDYKAGYTITAAPLVVKGKVITGISGGEFG-------VRGYVTAYDAKTGKLVWR 196 (527)
T ss_pred EEEEECCCCCEEeecccccccccccccCCcEEECCEEEEeecccccC-------CCcEEEEEECCCCceeEe
Confidence 78887 4 34687543211111112223466788877653221111 1237888888875 465
No 144
>PF13859 BNR_3: BNR repeat-like domain; PDB: 3B69_A.
Probab=62.49 E-value=1.4e+02 Score=28.05 Aligned_cols=184 Identities=18% Similarity=0.297 Sum_probs=85.4
Q ss_pred cEEEECCEEEEEeccC----CCCceeeeEEEE-ECCCCceeeCCC---CCCC---CccceeeEEEeCCEEEEEeCeeCCC
Q 014195 116 AAIQIKNLLYVFAGYG----SIDYVHSHVDIY-NFTDNTWGGRFD---MPRE---MAHSHLGMVTDGRYIYVVTGQYGPQ 184 (429)
Q Consensus 116 ~~~~~~~~iyv~GG~~----~~~~~~~~~~~y-d~~~~~W~~~~~---~~~~---~~r~~~~~~~~~~~lyv~GG~~~~~ 184 (429)
+++.+++.|+++..-. .+.....-+..+ -....+|+.... .... ......+.++.+++||++-|.....
T Consensus 3 SLV~vgGvv~AvAEa~~~~~~~~~~~~ias~~~~~~g~tw~~~~~~~~~~~~~~~v~v~rPTtvvkgn~IymLvG~y~~~ 82 (310)
T PF13859_consen 3 SLVEVGGVVFAVAEAQCKKSNDSGFTDIASEYSTDNGETWKAEVAVLNDDGSKKRVDVSRPTTVVKGNKIYMLVGSYSRS 82 (310)
T ss_dssp EEEEETTEEEEEEEEESS-S-SSS-EEEEEEEESSSSSS-EEEEEE----SS-TT-EEEEEEEEEETTEEEEEEEEESS-
T ss_pred CEEEECCEEEEEEEEEEccCCCCCceeEEEeEeeccccccccceeeecccccccccccceeeeeecceeEEEEEEEEecc
Confidence 5677888888877531 112222223334 345567875321 1111 1123456777899999987654432
Q ss_pred CCCCCceeEEE--eCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCC------------CCCCcccc-ceEeeeecC
Q 014195 185 CRGPTAHTFVL--DTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGE------------NRYTPEVD-HWSLAVKDG 249 (429)
Q Consensus 185 ~~~~~~~~~~y--d~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~------------~~~~~~~~-~~~~~~~~~ 249 (429)
.....-++..+ +....+|.....++..-..+ .+.++-||-.+ .......+ .+.+++|.-
T Consensus 83 ~~~~~~~llLvks~~~g~~W~~~~~l~~~~~~~------~~~figgGGSGV~m~dGTLVFPv~a~~~~~~~~~SlIiYS~ 156 (310)
T PF13859_consen 83 AGADDWGLLLVKSTDGGIKWGDTKSLPSTSFQS------WKQFIGGGGSGVVMEDGTLVFPVQATKKNGDGTVSLIIYST 156 (310)
T ss_dssp -SSTTEEEEEEEEESSSSEE---EE-GGGS-EE------EEEEEE-SEE-EE-TTS-EEEEEEEEETT---EEEEEEEES
T ss_pred ccccccceeeeeccCCcceeeecccCCchhccc------cceeecCCCCceEEcCCCEEEEEeeeccCccceEEEEEEEC
Confidence 21112334444 22334698876655322210 01233333111 01112233 467777753
Q ss_pred CccccceeeccCC-CCCCCceeEEEe-CCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEE-cCCC
Q 014195 250 KPLEKEWRTEIPI-PRGGPHRACVVV-DDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKV-LPSM 325 (429)
Q Consensus 250 d~~~~~W~~~~~~-p~~~~~~~~~~~-~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~-~~~~ 325 (429)
.....|+-...+ |.....+.++.. +++|+++.-.... ...||.-. ...+|+. +..+
T Consensus 157 -d~g~~W~lskg~s~~gC~~psv~EWe~gkLlM~~~c~~g-------------------~rrVYeS~DmG~tWtea~gtl 216 (310)
T PF13859_consen 157 -DDGKTWKLSKGMSPAGCSDPSVVEWEDGKLLMMTACDDG-------------------RRRVYESGDMGTTWTEALGTL 216 (310)
T ss_dssp -STTSS-EE-S----TT-EEEEEEEE-TTEEEEEEE-TTS----------------------EEEESSTTSS-EE-TTTT
T ss_pred -CCccceEeccccCCCCcceEEEEeccCCeeEEEEecccc-------------------eEEEEEEcccceehhhccCcc
Confidence 347789976666 455666777888 8899998765433 12477765 7889998 4444
No 145
>COG4880 Secreted protein containing C-terminal beta-propeller domain distantly related to WD-40 repeats [General function prediction only]
Probab=60.79 E-value=1.7e+02 Score=28.57 Aligned_cols=79 Identities=20% Similarity=0.140 Sum_probs=49.2
Q ss_pred CCcEEEECCEEEEEec---cCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCc
Q 014195 114 DGAAIQIKNLLYVFAG---YGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTA 190 (429)
Q Consensus 114 ~~~~~~~~~~iyv~GG---~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~ 190 (429)
.++...+++.+-++-- +..+..+.+.++++|-..+.=-++..+... -| -+++-..++.+|++-=+ .+.
T Consensus 379 ~f~~deyngylRvaTt~~dW~~~de~~N~vYilDe~lnvvGkltGl~~g-ER-IYAvRf~gdv~yiVTfr-------qtD 449 (603)
T COG4880 379 SFDGDEYNGYLRVATTLSDWTSEDEPVNAVYILDENLNVVGKLTGLAPG-ER-IYAVRFVGDVLYIVTFR-------QTD 449 (603)
T ss_pred cccCcccceEEEEEeeecccccCCCccceeEEEcCCCcEEEEEeccCCC-ce-EEEEEEeCceEEEEEEe-------ccC
Confidence 4555566666666443 334455678899999988877666665442 23 45566778889987321 144
Q ss_pred eeEEEeCCCCc
Q 014195 191 HTFVLDTETKK 201 (429)
Q Consensus 191 ~~~~yd~~t~~ 201 (429)
-+++.|++.-+
T Consensus 450 PlfviDlsNPe 460 (603)
T COG4880 450 PLFVIDLSNPE 460 (603)
T ss_pred ceEEEEcCCCC
Confidence 56677766543
No 146
>PF09910 DUF2139: Uncharacterized protein conserved in archaea (DUF2139); InterPro: IPR016675 There is currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=59.91 E-value=1.5e+02 Score=27.54 Aligned_cols=77 Identities=19% Similarity=0.137 Sum_probs=44.7
Q ss_pred eEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCe--EEecc------
Q 014195 310 VYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKW--HVIGK------ 380 (429)
Q Consensus 310 v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W--~~v~~------ 380 (429)
+|..| .+..=+.+..-|.+.. +.+.|-.++-+ .+... -.+.|.+||..+++| +....
T Consensus 133 vy~ldr~~g~~~~L~~~ps~KG-----~~~~D~a~F~i--~~~~~-------g~~~i~~~Dli~~~~~~e~f~~~~s~Dg 198 (339)
T PF09910_consen 133 VYSLDRRTGKAEKLSSNPSLKG-----TLVHDYACFGI--NNFHK-------GVSGIHCLDLISGKWVIESFDVSLSVDG 198 (339)
T ss_pred eEEEcccCCceeeccCCCCcCc-----eEeeeeEEEec--ccccc-------CCceEEEEEccCCeEEEEecccccCCCC
Confidence 89998 7888888776666643 13344444422 22222 256899999999999 43311
Q ss_pred -cCcceeeeeeEEECCEEEEE
Q 014195 381 -LPYRVKTTLAGYWNGWLYFT 400 (429)
Q Consensus 381 -lp~~r~~~~~~~~~~~i~v~ 400 (429)
....|....++...+++|.|
T Consensus 199 ~~~~~~~~G~~~s~ynR~faF 219 (339)
T PF09910_consen 199 GPVIRPELGAMASAYNRLFAF 219 (339)
T ss_pred CceEeeccccEEEEeeeEEEE
Confidence 11122334555666666654
No 147
>COG3823 Glutamine cyclotransferase [Posttranslational modification, protein turnover, chaperones]
Probab=56.48 E-value=1.4e+02 Score=26.21 Aligned_cols=101 Identities=14% Similarity=0.059 Sum_probs=59.1
Q ss_pred eeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCC-CCCCCceEEEECCEEEEEeCCCCCCCCccccce
Q 014195 164 HLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLP-VPRYAPATQLWRGRLHVMGGSGENRYTPEVDHW 242 (429)
Q Consensus 164 ~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p-~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~ 242 (429)
--++...++++|.--|..+ .+.+.++|+.+.+=..-.+++ ....+-..+..++.+|..-=.++..+. |
T Consensus 48 TQGL~~~~g~i~esTG~yg------~S~ir~~~L~~gq~~~s~~l~~~~~FgEGit~~gd~~y~LTw~egvaf~-----~ 116 (262)
T COG3823 48 TQGLEYLDGHILESTGLYG------FSKIRVSDLTTGQEIFSEKLAPDTVFGEGITKLGDYFYQLTWKEGVAFK-----Y 116 (262)
T ss_pred hcceeeeCCEEEEeccccc------cceeEEEeccCceEEEEeecCCccccccceeeccceEEEEEeccceeEE-----E
Confidence 3456777889998877655 568889999966533222333 334666778889999988433322211 1
Q ss_pred EeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEccc
Q 014195 243 SLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQ 284 (429)
Q Consensus 243 ~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~ 284 (429)
| .++.+.+...+-.+-+-+.+.-+..|.+--|.
T Consensus 117 -------d--~~t~~~lg~~~y~GeGWgLt~d~~~LimsdGs 149 (262)
T COG3823 117 -------D--ADTLEELGRFSYEGEGWGLTSDDKNLIMSDGS 149 (262)
T ss_pred -------C--hHHhhhhcccccCCcceeeecCCcceEeeCCc
Confidence 1 22223444444444444666656666665554
No 148
>PTZ00421 coronin; Provisional
Probab=56.48 E-value=2.3e+02 Score=28.64 Aligned_cols=22 Identities=14% Similarity=0.110 Sum_probs=15.3
Q ss_pred ceeeeecCCCcccceeeeeeecCCCCe
Q 014195 34 DFFWASSSKFTSSYLNIASNWSPYHNS 60 (429)
Q Consensus 34 ~~ly~~GG~~~~~~~~~~~~yd~~~~~ 60 (429)
+.+.+.||.++ .+..||..+.+
T Consensus 138 ~~iLaSgs~Dg-----tVrIWDl~tg~ 159 (493)
T PTZ00421 138 MNVLASAGADM-----VVNVWDVERGK 159 (493)
T ss_pred CCEEEEEeCCC-----EEEEEECCCCe
Confidence 34666677666 56788888776
No 149
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=55.99 E-value=2.7e+02 Score=29.33 Aligned_cols=144 Identities=13% Similarity=0.082 Sum_probs=69.6
Q ss_pred EEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEE
Q 014195 117 AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVL 195 (429)
Q Consensus 117 ~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~y 195 (429)
.++..+.+.++.|.++ ++-++|..+.+..+ .++. . +-+++..+ +++..+.|+.+ ..+..|
T Consensus 379 l~vS~d~~~~~Sga~~------SikiWn~~t~kciR--Ti~~--~-y~l~~~Fvpgd~~Iv~G~k~--------Gel~vf 439 (888)
T KOG0306|consen 379 LCVSSDSILLASGAGE------SIKIWNRDTLKCIR--TITC--G-YILASKFVPGDRYIVLGTKN--------GELQVF 439 (888)
T ss_pred EEeecCceeeeecCCC------cEEEEEccCcceeE--Eecc--c-cEEEEEecCCCceEEEeccC--------CceEEE
Confidence 3444666666655432 36677777665543 2332 2 34444444 55555566643 356778
Q ss_pred eCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccce------eeccCCCCCCCce
Q 014195 196 DTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEW------RTEIPIPRGGPHR 269 (429)
Q Consensus 196 d~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W------~~~~~~p~~~~~~ 269 (429)
|.....--+.-+...+--..-....+++-++.||.+ ..+..|++....--|.+.+= ++...++..- -+
T Consensus 440 dlaS~~l~Eti~AHdgaIWsi~~~pD~~g~vT~saD-----ktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddv-L~ 513 (888)
T KOG0306|consen 440 DLASASLVETIRAHDGAIWSISLSPDNKGFVTGSAD-----KTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDV-LC 513 (888)
T ss_pred EeehhhhhhhhhccccceeeeeecCCCCceEEecCC-----cEEEEEeEEEEeccCcccceeeeeccceEEeccccE-EE
Confidence 876543222111111111122223477778888765 56777877543322222211 0111222222 12
Q ss_pred eEEEeCCEEEEEcccC
Q 014195 270 ACVVVDDRLLVIGGQE 285 (429)
Q Consensus 270 ~~~~~~~~iyv~GG~~ 285 (429)
..+.-+++++++|=.+
T Consensus 514 v~~Spdgk~LaVsLLd 529 (888)
T KOG0306|consen 514 VSVSPDGKLLAVSLLD 529 (888)
T ss_pred EEEcCCCcEEEEEecc
Confidence 3334467877777654
No 150
>PF12217 End_beta_propel: Catalytic beta propeller domain of bacteriophage endosialidase; InterPro: IPR024428 This entry represents the beta propeller domain of endosialidases, which consists of catalytically active part of the enzymes. This core domain forms stable SDS-resistant trimers. There is a nested beta barrel domain in this domain. This domain is typically between 443 and 460 amino acids in length [].; PDB: 1V0E_B 1V0F_E 3JU4_A 3GVL_A 3GVK_B 3GVJ_A.
Probab=55.98 E-value=1.6e+02 Score=26.70 Aligned_cols=114 Identities=13% Similarity=0.028 Sum_probs=56.2
Q ss_pred ccCCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCcee--------eCCCCCCCCccceeeEEEeCCEEEEEeCeeCC
Q 014195 112 RLDGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWG--------GRFDMPREMAHSHLGMVTDGRYIYVVTGQYGP 183 (429)
Q Consensus 112 R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~--------~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~ 183 (429)
-.-|+.+.+++.-|.+|=.+++-.+..--..|=+ +.|. +++.- ....-+..++-..++.||+.---...
T Consensus 136 Te~HSFa~i~~~~fA~GyHnGD~sPRe~G~~yfs--~~~~sp~~~vrr~i~se-y~~~AsEPCvkyY~g~LyLtTRgt~~ 212 (367)
T PF12217_consen 136 TELHSFATIDDNQFAVGYHNGDVSPRELGFLYFS--DAFASPGVFVRRIIPSE-YERNASEPCVKYYDGVLYLTTRGTLP 212 (367)
T ss_dssp SEEEEEEE-SSS-EEEEEEE-SSSS-EEEEEEET--TTTT-TT--EEEE--GG-G-TTEEEEEEEEETTEEEEEEEES-T
T ss_pred eeeeeeeEecCCceeEEeccCCCCcceeeEEEec--ccccCCcceeeeechhh-hccccccchhhhhCCEEEEEEcCcCC
Confidence 3457888888877888866554332211122211 2221 22221 11123455667789999998432222
Q ss_pred CCCCCCceeEEEeCCCCceEeCC-CCCCCCCCceEEEECCEEEEEeCC
Q 014195 184 QCRGPTAHTFVLDTETKKWQDLP-PLPVPRYAPATQLWRGRLHVMGGS 230 (429)
Q Consensus 184 ~~~~~~~~~~~yd~~t~~W~~~~-~~p~~r~~~~~~~~~~~lyv~GG~ 230 (429)
. .+-+.+.+-+.....|+.+. +-..-....-.+..++.||+||-.
T Consensus 213 ~--~~GS~L~rs~d~G~~w~slrfp~nvHhtnlPFakvgD~l~mFgsE 258 (367)
T PF12217_consen 213 T--NPGSSLHRSDDNGQNWSSLRFPNNVHHTNLPFAKVGDVLYMFGSE 258 (367)
T ss_dssp T--S---EEEEESSTTSS-EEEE-TT---SS---EEEETTEEEEEEE-
T ss_pred C--CCcceeeeecccCCchhhccccccccccCCCceeeCCEEEEEecc
Confidence 1 12467778888888999874 211222333356789999999854
No 151
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=54.12 E-value=1.8e+02 Score=26.89 Aligned_cols=66 Identities=8% Similarity=-0.046 Sum_probs=40.9
Q ss_pred EEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEe
Q 014195 117 AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLD 196 (429)
Q Consensus 117 ~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd 196 (429)
++..++.-.++||.++ .+-+||..+..=.++..-..+. |. ..-. .....+|.||+++ .+..+|
T Consensus 60 c~F~d~~~~~~G~~dg------~vr~~Dln~~~~~~igth~~~i-~c-i~~~-~~~~~vIsgsWD~--------~ik~wD 122 (323)
T KOG1036|consen 60 CAFADESTIVTGGLDG------QVRRYDLNTGNEDQIGTHDEGI-RC-IEYS-YEVGCVISGSWDK--------TIKFWD 122 (323)
T ss_pred eeccCCceEEEeccCc------eEEEEEecCCcceeeccCCCce-EE-EEee-ccCCeEEEcccCc--------cEEEEe
Confidence 3444666667788755 4889999999877776655432 21 1111 2334678888754 566778
Q ss_pred CCC
Q 014195 197 TET 199 (429)
Q Consensus 197 ~~t 199 (429)
+..
T Consensus 123 ~R~ 125 (323)
T KOG1036|consen 123 PRN 125 (323)
T ss_pred ccc
Confidence 765
No 152
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=53.25 E-value=2.1e+02 Score=27.25 Aligned_cols=97 Identities=10% Similarity=0.074 Sum_probs=50.8
Q ss_pred hcceeeeecCCCcccceeeeeeecCCCCe--EEecCCCCCCCcceeeeecC-CCCcCcccccccccccccCCCeEEccCC
Q 014195 32 VADFFWASSSKFTSSYLNIASNWSPYHNS--IILPNNGPQKGENIGVKTKK-DVVPKRILPATFQDLPAPELKWEKMKAA 108 (429)
Q Consensus 32 ~~~~ly~~GG~~~~~~~~~~~~yd~~~~~--~~~p~~~~r~~~~~~~~~~~-~~~~~~~~~~~~~~~d~~~~~W~~~~~~ 108 (429)
-.|..|+.|.-|+ ++-.||.++.+ ..++.. ...-.++.+.... |..+.. ....+-++|...++.
T Consensus 161 P~n~wf~tgs~Dr-----tikIwDlatg~LkltltGh-i~~vr~vavS~rHpYlFs~g-edk~VKCwDLe~nkv------ 227 (460)
T KOG0285|consen 161 PGNEWFATGSADR-----TIKIWDLATGQLKLTLTGH-IETVRGVAVSKRHPYLFSAG-EDKQVKCWDLEYNKV------ 227 (460)
T ss_pred CCceeEEecCCCc-----eeEEEEcccCeEEEeecch-hheeeeeeecccCceEEEec-CCCeeEEEechhhhh------
Confidence 3566777777665 77899999999 667640 0011123332222 222211 234455566555432
Q ss_pred CCCcc--CCcEEEE------CCEEEEEeccCCCCceeeeEEEEECCCCc
Q 014195 109 PVPRL--DGAAIQI------KNLLYVFAGYGSIDYVHSHVDIYNFTDNT 149 (429)
Q Consensus 109 p~~R~--~~~~~~~------~~~iyv~GG~~~~~~~~~~~~~yd~~~~~ 149 (429)
-|. +|-..++ -..+++.||.+. .+.++|+.+..
T Consensus 228 --IR~YhGHlS~V~~L~lhPTldvl~t~grDs------t~RvWDiRtr~ 268 (460)
T KOG0285|consen 228 --IRHYHGHLSGVYCLDLHPTLDVLVTGGRDS------TIRVWDIRTRA 268 (460)
T ss_pred --HHHhccccceeEEEeccccceeEEecCCcc------eEEEeeecccc
Confidence 232 2222222 246788888653 35677877664
No 153
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=52.12 E-value=2.9e+02 Score=28.56 Aligned_cols=248 Identities=10% Similarity=0.125 Sum_probs=113.9
Q ss_pred eeeeecCCCCe---EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEE-ccCCCCCccCCcEEEE-CCEE
Q 014195 50 IASNWSPYHNS---IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEK-MKAAPVPRLDGAAIQI-KNLL 124 (429)
Q Consensus 50 ~~~~yd~~~~~---~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~-~~~~p~~R~~~~~~~~-~~~i 124 (429)
.+|.|++..+= ..++-...|+-.+++...+...... .++..+..+|+.+.+=.. +.....+-. +++.. .+.+
T Consensus 48 ~IEiwN~~~~w~~~~vi~g~~drsIE~L~W~e~~RLFS~-g~sg~i~EwDl~~lk~~~~~d~~gg~IW--siai~p~~~~ 124 (691)
T KOG2048|consen 48 NIEIWNLSNNWFLEPVIHGPEDRSIESLAWAEGGRLFSS-GLSGSITEWDLHTLKQKYNIDSNGGAIW--SIAINPENTI 124 (691)
T ss_pred cEEEEccCCCceeeEEEecCCCCceeeEEEccCCeEEee-cCCceEEEEecccCceeEEecCCCccee--EEEeCCccce
Confidence 67999998876 4455566666677776622211111 133444455555432111 011111111 11111 3456
Q ss_pred EEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEe
Q 014195 125 YVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQD 204 (429)
Q Consensus 125 yv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~ 204 (429)
..+|-.++ -+..++...+.-+.-..++....| -.++.....-.=++||..+ --+-++|..++.=..
T Consensus 125 l~IgcddG------vl~~~s~~p~~I~~~r~l~rq~sR-vLslsw~~~~~~i~~Gs~D-------g~Iriwd~~~~~t~~ 190 (691)
T KOG2048|consen 125 LAIGCDDG------VLYDFSIGPDKITYKRSLMRQKSR-VLSLSWNPTGTKIAGGSID-------GVIRIWDVKSGQTLH 190 (691)
T ss_pred EEeecCCc------eEEEEecCCceEEEEeecccccce-EEEEEecCCccEEEecccC-------ceEEEEEcCCCceEE
Confidence 66664333 244555555555443344442223 2334443333337777422 124567777665444
Q ss_pred CCCCCC---CCCCce----EEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCC-
Q 014195 205 LPPLPV---PRYAPA----TQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDD- 276 (429)
Q Consensus 205 ~~~~p~---~r~~~~----~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~- 276 (429)
+-.|.. .+...+ +..+.+...+.|-.. ..+..|+. ...+-.+.-..-.+-. .+.++-++
T Consensus 191 ~~~~~~d~l~k~~~~iVWSv~~Lrd~tI~sgDS~-----G~V~FWd~-------~~gTLiqS~~~h~adV-l~Lav~~~~ 257 (691)
T KOG2048|consen 191 IITMQLDRLSKREPTIVWSVLFLRDSTIASGDSA-----GTVTFWDS-------IFGTLIQSHSCHDADV-LALAVADNE 257 (691)
T ss_pred EeeecccccccCCceEEEEEEEeecCcEEEecCC-----ceEEEEcc-------cCcchhhhhhhhhcce-eEEEEcCCC
Confidence 333322 221222 234566666666544 35778873 2322222111112221 23333333
Q ss_pred EEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC---CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCC
Q 014195 277 RLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD---DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTE 351 (429)
Q Consensus 277 ~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d---~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~ 351 (429)
.-++.+|.++. +..|. ...+|....+-..+..... ++++.++ +++-||.+.
T Consensus 258 d~vfsaGvd~~----------------------ii~~~~~~~~~~wv~~~~r~~h~hdvr-s~av~~~-~l~sgG~d~ 311 (691)
T KOG2048|consen 258 DRVFSAGVDPK----------------------IIQYSLTTNKSEWVINSRRDLHAHDVR-SMAVIEN-ALISGGRDF 311 (691)
T ss_pred CeEEEccCCCc----------------------eEEEEecCCccceeeeccccCCcccce-eeeeecc-eEEecceee
Confidence 34555665543 45554 3445887654322222222 3566666 778888754
No 154
>PTZ00420 coronin; Provisional
Probab=51.23 E-value=3e+02 Score=28.41 Aligned_cols=22 Identities=14% Similarity=0.185 Sum_probs=15.1
Q ss_pred ceeeeecCCCcccceeeeeeecCCCCe
Q 014195 34 DFFWASSSKFTSSYLNIASNWSPYHNS 60 (429)
Q Consensus 34 ~~ly~~GG~~~~~~~~~~~~yd~~~~~ 60 (429)
..+.+.||.++ .+..||..+.+
T Consensus 138 ~~iLaSgS~Dg-----tIrIWDl~tg~ 159 (568)
T PTZ00420 138 YYIMCSSGFDS-----FVNIWDIENEK 159 (568)
T ss_pred CeEEEEEeCCC-----eEEEEECCCCc
Confidence 34556677665 56788888776
No 155
>PF13570 PQQ_3: PQQ-like domain; PDB: 3HXJ_B 3Q54_A.
Probab=51.11 E-value=32 Score=20.69 Aligned_cols=26 Identities=31% Similarity=0.475 Sum_probs=16.9
Q ss_pred eeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 165 LGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 165 ~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
.+.++.++.||+.+. ...++++|++|
T Consensus 15 ~~~~v~~g~vyv~~~---------dg~l~ald~~t 40 (40)
T PF13570_consen 15 SSPAVAGGRVYVGTG---------DGNLYALDAAT 40 (40)
T ss_dssp S--EECTSEEEEE-T---------TSEEEEEETT-
T ss_pred cCCEEECCEEEEEcC---------CCEEEEEeCCC
Confidence 344677899888754 45788898864
No 156
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=50.04 E-value=3.1e+02 Score=28.33 Aligned_cols=40 Identities=13% Similarity=0.189 Sum_probs=29.5
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeC
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTG 179 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG 179 (429)
.+|+||+.. .|-....++.|.-|+--+++.. +++||-+|+
T Consensus 48 ~IEiwN~~~-~w~~~~vi~g~~drsIE~L~W~e~~RLFS~g~ 88 (691)
T KOG2048|consen 48 NIEIWNLSN-NWFLEPVIHGPEDRSIESLAWAEGGRLFSSGL 88 (691)
T ss_pred cEEEEccCC-CceeeEEEecCCCCceeeEEEccCCeEEeecC
Confidence 499999976 7877666555545665566666 889999987
No 157
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=47.61 E-value=2.8e+02 Score=27.18 Aligned_cols=131 Identities=16% Similarity=0.236 Sum_probs=66.0
Q ss_pred EEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccce-eeEEEeC--CEEEEEeCeeCCCCCCCCceeEE
Q 014195 118 IQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSH-LGMVTDG--RYIYVVTGQYGPQCRGPTAHTFV 194 (429)
Q Consensus 118 ~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~-~~~~~~~--~~lyv~GG~~~~~~~~~~~~~~~ 194 (429)
+..+++.+++||.+. .+.++|+.+.+=.+ .++. .|.. .+++.-. +.+|..+- ...+-.
T Consensus 210 vS~Dgkylatgg~d~------~v~Iw~~~t~ehv~--~~~g--hr~~V~~L~fr~gt~~lys~s~---------Drsvkv 270 (479)
T KOG0299|consen 210 VSSDGKYLATGGRDR------HVQIWDCDTLEHVK--VFKG--HRGAVSSLAFRKGTSELYSASA---------DRSVKV 270 (479)
T ss_pred EcCCCcEEEecCCCc------eEEEecCcccchhh--cccc--cccceeeeeeecCccceeeeec---------CCceEE
Confidence 344889999998754 36677776654222 2222 1221 2223222 34554421 122333
Q ss_pred EeCCCCceEeCCCCCCCCCCceEEE------ECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCc
Q 014195 195 LDTETKKWQDLPPLPVPRYAPATQL------WRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPH 268 (429)
Q Consensus 195 yd~~t~~W~~~~~~p~~r~~~~~~~------~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~ 268 (429)
|+.+.... -...++|...+ -..++..+||.+ .++..|.+ |+.-+ +.-.+...+-
T Consensus 271 w~~~~~s~------vetlyGHqd~v~~IdaL~reR~vtVGgrD-----rT~rlwKi------~eesq---lifrg~~~si 330 (479)
T KOG0299|consen 271 WSIDQLSY------VETLYGHQDGVLGIDALSRERCVTVGGRD-----RTVRLWKI------PEESQ---LIFRGGEGSI 330 (479)
T ss_pred EehhHhHH------HHHHhCCccceeeechhcccceEEecccc-----ceeEEEec------cccce---eeeeCCCCCe
Confidence 33332211 11233443332 257888899976 45677765 22211 1111223233
Q ss_pred eeEEEeCCEEEEEcccCCC
Q 014195 269 RACVVVDDRLLVIGGQEGD 287 (429)
Q Consensus 269 ~~~~~~~~~iyv~GG~~~~ 287 (429)
-+++.+++.=||.|+.++.
T Consensus 331 dcv~~In~~HfvsGSdnG~ 349 (479)
T KOG0299|consen 331 DCVAFINDEHFVSGSDNGS 349 (479)
T ss_pred eeEEEecccceeeccCCce
Confidence 3777889999999988765
No 158
>PF02897 Peptidase_S9_N: Prolyl oligopeptidase, N-terminal beta-propeller domain; InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold: Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases. In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding. Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs. Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=46.97 E-value=2.8e+02 Score=26.92 Aligned_cols=194 Identities=13% Similarity=0.174 Sum_probs=91.0
Q ss_pred eeeEEEEECCCCcee--eCCCCCCCCccc-eeeEEE-eCC-EEEEEeCeeCCCCCCCC-ceeEEEeCCCC-----ceEeC
Q 014195 137 HSHVDIYNFTDNTWG--GRFDMPREMAHS-HLGMVT-DGR-YIYVVTGQYGPQCRGPT-AHTFVLDTETK-----KWQDL 205 (429)
Q Consensus 137 ~~~~~~yd~~~~~W~--~~~~~~~~~~r~-~~~~~~-~~~-~lyv~GG~~~~~~~~~~-~~~~~yd~~t~-----~W~~~ 205 (429)
...++++...+..-+ .+-..+. ... ...+.. .++ .|+|.-. ... . ++++..|.... .|..+
T Consensus 201 ~~~v~~~~~gt~~~~d~lvfe~~~--~~~~~~~~~~s~d~~~l~i~~~--~~~----~~s~v~~~d~~~~~~~~~~~~~l 272 (414)
T PF02897_consen 201 PRQVYRHKLGTPQSEDELVFEEPD--EPFWFVSVSRSKDGRYLFISSS--SGT----SESEVYLLDLDDGGSPDAKPKLL 272 (414)
T ss_dssp CEEEEEEETTS-GGG-EEEEC-TT--CTTSEEEEEE-TTSSEEEEEEE--SSS----SEEEEEEEECCCTTTSS-SEEEE
T ss_pred CcEEEEEECCCChHhCeeEEeecC--CCcEEEEEEecCcccEEEEEEE--ccc----cCCeEEEEeccccCCCcCCcEEE
Confidence 456889888887655 3322222 122 222222 233 3443322 111 3 78999999875 78877
Q ss_pred CCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceee-ccCCCCCCCceeEEEeCCEEEEEccc
Q 014195 206 PPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRT-EIPIPRGGPHRACVVVDDRLLVIGGQ 284 (429)
Q Consensus 206 ~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~-~~~~p~~~~~~~~~~~~~~iyv~GG~ 284 (429)
.+- ..-....+...++.+|+.-..+... -......+ -++....|.. +.+-.....-..+...++.|++.-=.
T Consensus 273 ~~~-~~~~~~~v~~~~~~~yi~Tn~~a~~----~~l~~~~l--~~~~~~~~~~~l~~~~~~~~l~~~~~~~~~Lvl~~~~ 345 (414)
T PF02897_consen 273 SPR-EDGVEYYVDHHGDRLYILTNDDAPN----GRLVAVDL--ADPSPAEWWTVLIPEDEDVSLEDVSLFKDYLVLSYRE 345 (414)
T ss_dssp EES-SSS-EEEEEEETTEEEEEE-TT-TT-----EEEEEET--TSTSGGGEEEEEE--SSSEEEEEEEEETTEEEEEEEE
T ss_pred eCC-CCceEEEEEccCCEEEEeeCCCCCC----cEEEEecc--cccccccceeEEcCCCCceeEEEEEEECCEEEEEEEE
Confidence 541 1222233445689999986633211 11111111 1233335664 33333322333556678888776544
Q ss_pred CCCCCCCCCCCccccccCCeeeeCceEEeCCCCCeEEcC-CCCCCCCCcceeEEE--E-CC-EEEEEcccCCCCCCccce
Q 014195 285 EGDFMAKPGSPIFKCSRRNEVVYDDVYMLDDEMKWKVLP-SMPKPDSHIEFAWVL--V-NN-SIVIVGGTTEKHPTTKKM 359 (429)
Q Consensus 285 ~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d~~~~W~~~~-~~~~~r~~~~~~~~~--~-~~-~i~v~GG~~~~~~~~~~~ 359 (429)
++ ...+..++....|.... ++|.. . ...... . .+ -.|.+.+....
T Consensus 346 ~~--------------------~~~l~v~~~~~~~~~~~~~~p~~-g--~v~~~~~~~~~~~~~~~~ss~~~P------- 395 (414)
T PF02897_consen 346 NG--------------------SSRLRVYDLDDGKESREIPLPEA-G--SVSGVSGDFDSDELRFSYSSFTTP------- 395 (414)
T ss_dssp TT--------------------EEEEEEEETT-TEEEEEEESSSS-S--EEEEEES-TT-SEEEEEEEETTEE-------
T ss_pred CC--------------------ccEEEEEECCCCcEEeeecCCcc-e--EEeccCCCCCCCEEEEEEeCCCCC-------
Confidence 32 22467776222444332 23321 1 111111 1 12 33444444432
Q ss_pred eeeCcEEEEecCCCCeEEe
Q 014195 360 VLVGEIFQFNLNTLKWHVI 378 (429)
Q Consensus 360 ~~~~~i~~yd~~~~~W~~v 378 (429)
..++.||+.+++.+.+
T Consensus 396 ---~~~y~~d~~t~~~~~~ 411 (414)
T PF02897_consen 396 ---PTVYRYDLATGELTLL 411 (414)
T ss_dssp ---EEEEEEETTTTCEEEE
T ss_pred ---CEEEEEECCCCCEEEE
Confidence 2899999999987765
No 159
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=45.42 E-value=2.6e+02 Score=26.07 Aligned_cols=122 Identities=11% Similarity=0.106 Sum_probs=59.8
Q ss_pred ccccCCCeEEccCCCCCccCCcEEEE----CCEEEEEeccCCCCceeeeEEEEECC-CCceeeCCC---CCCCCccce--
Q 014195 95 LPAPELKWEKMKAAPVPRLDGAAIQI----KNLLYVFAGYGSIDYVHSHVDIYNFT-DNTWGGRFD---MPREMAHSH-- 164 (429)
Q Consensus 95 ~d~~~~~W~~~~~~p~~R~~~~~~~~----~~~iyv~GG~~~~~~~~~~~~~yd~~-~~~W~~~~~---~~~~~~r~~-- 164 (429)
.+..+.+|.+...|...|....-+.. -+-..+.-+.++. +.-.|.-||. ..+|+.... ++.|+.+..
T Consensus 95 ~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~---lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~ 171 (361)
T KOG2445|consen 95 EEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGI---LRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQP 171 (361)
T ss_pred cccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcE---EEEEecCCccccccchhhhhhhhccCCcccccCc
Confidence 34455689888888766654332222 1223333332221 1112223332 346875433 333323221
Q ss_pred -eeEEEe----CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCC--------------CCCCCceEEEE
Q 014195 165 -LGMVTD----GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLP--------------VPRYAPATQLW 220 (429)
Q Consensus 165 -~~~~~~----~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p--------------~~r~~~~~~~~ 220 (429)
+++... ...++++|-.. .........+|.|+-..++|..++.+| ..|..|.+++.
T Consensus 172 ~~CvsWn~sr~~~p~iAvgs~e-~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~y~~lAvA 245 (361)
T KOG2445|consen 172 CFCVSWNPSRMHEPLIAVGSDE-DAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRSYHLLAVA 245 (361)
T ss_pred ceEEeeccccccCceEEEEccc-CCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCceeeEEEe
Confidence 222222 23466666543 322222345677788888999987543 45666666654
No 160
>PRK10115 protease 2; Provisional
Probab=45.26 E-value=4e+02 Score=28.22 Aligned_cols=194 Identities=11% Similarity=0.100 Sum_probs=88.8
Q ss_pred eeEEEEECCCCcee--eCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeC--CCCceEeCCCCCCCC
Q 014195 138 SHVDIYNFTDNTWG--GRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDT--ETKKWQDLPPLPVPR 212 (429)
Q Consensus 138 ~~~~~yd~~~~~W~--~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~--~t~~W~~~~~~p~~r 212 (429)
.+++++++.+..-+ .+-.-+. .......... +++..++..... ..++++.|+. .+..|..+.+.+..
T Consensus 199 ~~v~~h~lgt~~~~d~lv~~e~~--~~~~~~~~~s~d~~~l~i~~~~~-----~~~~~~l~~~~~~~~~~~~~~~~~~~- 270 (686)
T PRK10115 199 YQVWRHTIGTPASQDELVYEEKD--DTFYVSLHKTTSKHYVVIHLASA-----TTSEVLLLDAELADAEPFVFLPRRKD- 270 (686)
T ss_pred CEEEEEECCCChhHCeEEEeeCC--CCEEEEEEEcCCCCEEEEEEECC-----ccccEEEEECcCCCCCceEEEECCCC-
Confidence 56999999988432 2322111 1222222322 343333433222 1457888873 23444333222221
Q ss_pred CCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCcc-ccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCC
Q 014195 213 YAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPL-EKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAK 291 (429)
Q Consensus 213 ~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~-~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~ 291 (429)
........++.+|+.--.+...+ ..... +.. ...|+.+.+......--.+...++.|++..-.++.
T Consensus 271 ~~~~~~~~~~~ly~~tn~~~~~~----~l~~~-----~~~~~~~~~~l~~~~~~~~i~~~~~~~~~l~~~~~~~g~---- 337 (686)
T PRK10115 271 HEYSLDHYQHRFYLRSNRHGKNF----GLYRT-----RVRDEQQWEELIPPRENIMLEGFTLFTDWLVVEERQRGL---- 337 (686)
T ss_pred CEEEEEeCCCEEEEEEcCCCCCc----eEEEe-----cCCCcccCeEEECCCCCCEEEEEEEECCEEEEEEEeCCE----
Confidence 11233345678888854322111 11111 122 46788866552222112445567777776544322
Q ss_pred CCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEE-EEC-CEEE-EEcccCCCCCCccceeeeCcEEE
Q 014195 292 PGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWV-LVN-NSIV-IVGGTTEKHPTTKKMVLVGEIFQ 367 (429)
Q Consensus 292 ~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~-~~~-~~i~-v~GG~~~~~~~~~~~~~~~~i~~ 367 (429)
..++.+| .+.....+. ++.+......... ..+ +.++ .+.+.... .+++.
T Consensus 338 ----------------~~l~~~~~~~~~~~~l~-~~~~~~~~~~~~~~~~~~~~~~~~~ss~~~P----------~~~y~ 390 (686)
T PRK10115 338 ----------------TSLRQINRKTREVIGIA-FDDPAYVTWIAYNPEPETSRLRYGYSSMTTP----------DTLFE 390 (686)
T ss_pred ----------------EEEEEEcCCCCceEEec-CCCCceEeeecccCCCCCceEEEEEecCCCC----------CEEEE
Confidence 2367776 444554443 1222221100000 012 2332 23333222 38999
Q ss_pred EecCCCCeEEec
Q 014195 368 FNLNTLKWHVIG 379 (429)
Q Consensus 368 yd~~~~~W~~v~ 379 (429)
||+.+.+|+.+.
T Consensus 391 ~d~~~~~~~~l~ 402 (686)
T PRK10115 391 LDMDTGERRVLK 402 (686)
T ss_pred EECCCCcEEEEE
Confidence 999999888764
No 161
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=45.23 E-value=3.3e+02 Score=27.21 Aligned_cols=80 Identities=14% Similarity=0.164 Sum_probs=43.4
Q ss_pred ceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcc
Q 014195 255 EWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIE 333 (429)
Q Consensus 255 ~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~ 333 (429)
.|.+...-|.... +....+..|++-=|++. .++.|| ....-+..-.-..|...
T Consensus 202 ~~~~~HsAP~~gi--cfspsne~l~vsVG~Dk----------------------ki~~yD~~s~~s~~~l~y~~Plst-- 255 (673)
T KOG4378|consen 202 HASEAHSAPCRGI--CFSPSNEALLVSVGYDK----------------------KINIYDIRSQASTDRLTYSHPLST-- 255 (673)
T ss_pred chhhhccCCcCcc--eecCCccceEEEecccc----------------------eEEEeecccccccceeeecCCcce--
Confidence 3555555555543 55567888888888753 388887 43322221111222221
Q ss_pred eeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCC
Q 014195 334 FAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTL 373 (429)
Q Consensus 334 ~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~ 373 (429)
.+..-+|.++++|-.++ .++.||....
T Consensus 256 -vaf~~~G~~L~aG~s~G------------~~i~YD~R~~ 282 (673)
T KOG4378|consen 256 -VAFSECGTYLCAGNSKG------------ELIAYDMRST 282 (673)
T ss_pred -eeecCCceEEEeecCCc------------eEEEEecccC
Confidence 11334566777764432 6888887654
No 162
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=44.34 E-value=2.7e+02 Score=25.90 Aligned_cols=87 Identities=11% Similarity=0.101 Sum_probs=47.4
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEE
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQ 218 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~ 218 (429)
++-.||...++-...-.... | -..++..+..=.++||.+ ..+-+||..+..=..+..--.+...-.-
T Consensus 36 slrlYdv~~~~l~~~~~~~~--p--lL~c~F~d~~~~~~G~~d--------g~vr~~Dln~~~~~~igth~~~i~ci~~- 102 (323)
T KOG1036|consen 36 SLRLYDVPANSLKLKFKHGA--P--LLDCAFADESTIVTGGLD--------GQVRRYDLNTGNEDQIGTHDEGIRCIEY- 102 (323)
T ss_pred cEEEEeccchhhhhheecCC--c--eeeeeccCCceEEEeccC--------ceEEEEEecCCcceeeccCCCceEEEEe-
Confidence 36788888773322111111 1 234455565556677754 4677899999876666532222111000
Q ss_pred EECCEEEEEeCCCCCCCCccccceE
Q 014195 219 LWRGRLHVMGGSGENRYTPEVDHWS 243 (429)
Q Consensus 219 ~~~~~lyv~GG~~~~~~~~~~~~~~ 243 (429)
......+|.||++ ..+..|+
T Consensus 103 ~~~~~~vIsgsWD-----~~ik~wD 122 (323)
T KOG1036|consen 103 SYEVGCVISGSWD-----KTIKFWD 122 (323)
T ss_pred eccCCeEEEcccC-----ccEEEEe
Confidence 1234567778876 4577787
No 163
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=44.17 E-value=2.4e+02 Score=25.29 Aligned_cols=121 Identities=13% Similarity=0.136 Sum_probs=66.3
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCce--
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPA-- 216 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~-- 216 (429)
.+..+||....-.+.-.-.. .----+....++.-|..||- -..+..||.+|.+-.+- -| .|.
T Consensus 40 tvrLWNp~rg~liktYsghG--~EVlD~~~s~Dnskf~s~Gg--------Dk~v~vwDV~TGkv~Rr-----~r-gH~aq 103 (307)
T KOG0316|consen 40 TVRLWNPLRGALIKTYSGHG--HEVLDAALSSDNSKFASCGG--------DKAVQVWDVNTGKVDRR-----FR-GHLAQ 103 (307)
T ss_pred eEEeecccccceeeeecCCC--ceeeeccccccccccccCCC--------CceEEEEEcccCeeeee-----cc-cccce
Confidence 46777887765433211111 00011122335555555553 45788999999764321 11 121
Q ss_pred --EEEEC--CEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCC
Q 014195 217 --TQLWR--GRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGD 287 (429)
Q Consensus 217 --~~~~~--~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~ 287 (429)
.+.++ ..+.+-|+.+ .++..|+ ......+.+..+..+.-+-..+.+.+...|.|..++.
T Consensus 104 VNtV~fNeesSVv~SgsfD-----~s~r~wD-------CRS~s~ePiQildea~D~V~Si~v~~heIvaGS~DGt 166 (307)
T KOG0316|consen 104 VNTVRFNEESSVVASGSFD-----SSVRLWD-------CRSRSFEPIQILDEAKDGVSSIDVAEHEIVAGSVDGT 166 (307)
T ss_pred eeEEEecCcceEEEecccc-----ceeEEEE-------cccCCCCccchhhhhcCceeEEEecccEEEeeccCCc
Confidence 22333 3466666654 5688887 4455555555555666656777888888888776544
No 164
>COG1520 FOG: WD40-like repeat [Function unknown]
Probab=43.01 E-value=3.1e+02 Score=26.24 Aligned_cols=91 Identities=19% Similarity=0.163 Sum_probs=51.9
Q ss_pred EEECCEEEEEeccCCCCceeeeEEEEECCCCc--eeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEE
Q 014195 118 IQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNT--WGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVL 195 (429)
Q Consensus 118 ~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~--W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~y 195 (429)
+..++++|+.. .++ .+..+|+.+.+ |........ ..........+++||+-.. ...+++|
T Consensus 65 ~~~dg~v~~~~-~~G------~i~A~d~~~g~~~W~~~~~~~~--~~~~~~~~~~~G~i~~g~~---------~g~~y~l 126 (370)
T COG1520 65 ADGDGTVYVGT-RDG------NIFALNPDTGLVKWSYPLLGAV--AQLSGPILGSDGKIYVGSW---------DGKLYAL 126 (370)
T ss_pred EeeCCeEEEec-CCC------cEEEEeCCCCcEEecccCcCcc--eeccCceEEeCCeEEEecc---------cceEEEE
Confidence 66688999861 111 58999999887 965322100 1111222233777775422 2268899
Q ss_pred eCCC--CceEeCCCCCCCCCCceEEEECCEEEEE
Q 014195 196 DTET--KKWQDLPPLPVPRYAPATQLWRGRLHVM 227 (429)
Q Consensus 196 d~~t--~~W~~~~~~p~~r~~~~~~~~~~~lyv~ 227 (429)
|..+ ..|+.-.+.. ++.....+..++.+|+.
T Consensus 127 d~~~G~~~W~~~~~~~-~~~~~~~v~~~~~v~~~ 159 (370)
T COG1520 127 DASTGTLVWSRNVGGS-PYYASPPVVGDGTVYVG 159 (370)
T ss_pred ECCCCcEEEEEecCCC-eEEecCcEEcCcEEEEe
Confidence 9964 4588754442 44444455556666666
No 165
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=42.42 E-value=1.5e+02 Score=30.04 Aligned_cols=59 Identities=14% Similarity=0.177 Sum_probs=36.6
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCCCCCCCccccceE
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWS 243 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~ 243 (429)
.-.||+.|- -.++|++|++.+.|-.-=....+--.+..+.--+.|+++||.++ .++.|+
T Consensus 145 scDly~~gs---------g~evYRlNLEqGrfL~P~~~~~~~lN~v~in~~hgLla~Gt~~g-----~VEfwD 203 (703)
T KOG2321|consen 145 SCDLYLVGS---------GSEVYRLNLEQGRFLNPFETDSGELNVVSINEEHGLLACGTEDG-----VVEFWD 203 (703)
T ss_pred CccEEEeec---------CcceEEEEccccccccccccccccceeeeecCccceEEecccCc-----eEEEec
Confidence 446787753 57899999999998753222222222222223467888988663 467776
No 166
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=41.09 E-value=3.3e+02 Score=26.00 Aligned_cols=131 Identities=17% Similarity=0.221 Sum_probs=63.9
Q ss_pred CCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccc
Q 014195 221 RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCS 300 (429)
Q Consensus 221 ~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~ 300 (429)
++.+.+.||-+. ....|+. .+..|--..+--....-.....+++.++.-|+.++.-
T Consensus 75 ~~~l~aTGGgDD-----~AflW~~-------~~ge~~~eltgHKDSVt~~~FshdgtlLATGdmsG~v------------ 130 (399)
T KOG0296|consen 75 NNNLVATGGGDD-----LAFLWDI-------STGEFAGELTGHKDSVTCCSFSHDGTLLATGDMSGKV------------ 130 (399)
T ss_pred CCceEEecCCCc-----eEEEEEc-------cCCcceeEecCCCCceEEEEEccCceEEEecCCCccE------------
Confidence 677888888664 3455653 2333332211111111224456688899999987541
Q ss_pred cCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEE-ECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEe
Q 014195 301 RRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVL-VNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVI 378 (429)
Q Consensus 301 ~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~-~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v 378 (429)
.|+.-+ ...+|....++. ...- +.. ....|+++|-.++ .+|.|.+.+..-.++
T Consensus 131 --------~v~~~stg~~~~~~~~e~~----dieW-l~WHp~a~illAG~~DG------------svWmw~ip~~~~~kv 185 (399)
T KOG0296|consen 131 --------LVFKVSTGGEQWKLDQEVE----DIEW-LKWHPRAHILLAGSTDG------------SVWMWQIPSQALCKV 185 (399)
T ss_pred --------EEEEcccCceEEEeecccC----ceEE-EEecccccEEEeecCCC------------cEEEEECCCcceeeE
Confidence 133333 445666542211 0000 011 1235667775443 689998887644444
Q ss_pred cccCcceeeeeeEEECCEEEEE
Q 014195 379 GKLPYRVKTTLAGYWNGWLYFT 400 (429)
Q Consensus 379 ~~lp~~r~~~~~~~~~~~i~v~ 400 (429)
-.=+..+...+-+..+||..+.
T Consensus 186 ~~Gh~~~ct~G~f~pdGKr~~t 207 (399)
T KOG0296|consen 186 MSGHNSPCTCGEFIPDGKRILT 207 (399)
T ss_pred ecCCCCCcccccccCCCceEEE
Confidence 2223333334444455555554
No 167
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=39.12 E-value=1.5e+02 Score=27.91 Aligned_cols=101 Identities=17% Similarity=0.215 Sum_probs=52.4
Q ss_pred CCceEEEECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCC
Q 014195 213 YAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKP 292 (429)
Q Consensus 213 ~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~ 292 (429)
....++.+++| |++--.. +....+|+.. +... +-.+.--+.+-++..++|++.|-|..+..
T Consensus 321 AaVNvVdfd~k-yIVsASg----DRTikvW~~s-------t~ef--vRtl~gHkRGIAClQYr~rlvVSGSSDnt----- 381 (499)
T KOG0281|consen 321 AAVNVVDFDDK-YIVSASG----DRTIKVWSTS-------TCEF--VRTLNGHKRGIACLQYRDRLVVSGSSDNT----- 381 (499)
T ss_pred hheeeeccccc-eEEEecC----CceEEEEecc-------ceee--ehhhhcccccceehhccCeEEEecCCCce-----
Confidence 33334456777 4443221 2456677632 2222 22233233345888999999998876422
Q ss_pred CCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCC
Q 014195 293 GSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKH 353 (429)
Q Consensus 293 ~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~ 353 (429)
+-.+| ....--.+-.-.+..- -++..+++-+|-|++++..
T Consensus 382 -----------------IRlwdi~~G~cLRvLeGHEeLv----RciRFd~krIVSGaYDGki 422 (499)
T KOG0281|consen 382 -----------------IRLWDIECGACLRVLEGHEELV----RCIRFDNKRIVSGAYDGKI 422 (499)
T ss_pred -----------------EEEEeccccHHHHHHhchHHhh----hheeecCceeeeccccceE
Confidence 44444 3322111111111111 1378899999999998754
No 168
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=38.91 E-value=3.9e+02 Score=26.30 Aligned_cols=60 Identities=12% Similarity=0.104 Sum_probs=31.5
Q ss_pred CcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEE-EeCCEEEEEeCeeC
Q 014195 115 GAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMV-TDGRYIYVVTGQYG 182 (429)
Q Consensus 115 ~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~-~~~~~lyv~GG~~~ 182 (429)
++++..+.-.|++||.-. .+++++...++.--.+-. .. .+.-.++. ..++.+++.||.++
T Consensus 85 ~al~s~n~G~~l~ag~i~-----g~lYlWelssG~LL~v~~-aH--YQ~ITcL~fs~dgs~iiTgskDg 145 (476)
T KOG0646|consen 85 HALASSNLGYFLLAGTIS-----GNLYLWELSSGILLNVLS-AH--YQSITCLKFSDDGSHIITGSKDG 145 (476)
T ss_pred eeeecCCCceEEEeeccc-----CcEEEEEeccccHHHHHH-hh--ccceeEEEEeCCCcEEEecCCCc
Confidence 555666666777777322 237777777765322210 00 01111222 33778888888765
No 169
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=38.33 E-value=2.6e+02 Score=24.00 Aligned_cols=71 Identities=14% Similarity=0.139 Sum_probs=38.1
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
++++.|+-|... ..+.+||.+. ..+..++.. ++ ....-.-+++++++||..+. ..++..||..
T Consensus 71 g~~favi~g~~~-----~~v~lyd~~~---~~i~~~~~~-~~-n~i~wsP~G~~l~~~g~~n~-----~G~l~~wd~~-- 133 (194)
T PF08662_consen 71 GNEFAVIYGSMP-----AKVTLYDVKG---KKIFSFGTQ-PR-NTISWSPDGRFLVLAGFGNL-----NGDLEFWDVR-- 133 (194)
T ss_pred CCEEEEEEccCC-----cccEEEcCcc---cEeEeecCC-Cc-eEEEECCCCCEEEEEEccCC-----CcEEEEEECC--
Confidence 456666655221 2488999863 333333331 22 22222236777888876432 2468889988
Q ss_pred ceEeCCCC
Q 014195 201 KWQDLPPL 208 (429)
Q Consensus 201 ~W~~~~~~ 208 (429)
++..+...
T Consensus 134 ~~~~i~~~ 141 (194)
T PF08662_consen 134 KKKKISTF 141 (194)
T ss_pred CCEEeecc
Confidence 44444433
No 170
>PRK01742 tolB translocation protein TolB; Provisional
Probab=38.20 E-value=4e+02 Score=26.16 Aligned_cols=76 Identities=8% Similarity=0.141 Sum_probs=40.4
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK 200 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~ 200 (429)
+++.+++...+.. ...++++|..+.+-+.+...+. ........-.+.+|++....++ ..++|.+|+.+.
T Consensus 214 DG~~la~~s~~~~---~~~i~i~dl~tg~~~~l~~~~g--~~~~~~wSPDG~~La~~~~~~g------~~~Iy~~d~~~~ 282 (429)
T PRK01742 214 DGSKLAYVSFENK---KSQLVVHDLRSGARKVVASFRG--HNGAPAFSPDGSRLAFASSKDG------VLNIYVMGANGG 282 (429)
T ss_pred CCCEEEEEEecCC---CcEEEEEeCCCCceEEEecCCC--ccCceeECCCCCEEEEEEecCC------cEEEEEEECCCC
Confidence 4444444443322 2358999998887666655443 1111222222344554332221 346889999888
Q ss_pred ceEeCCC
Q 014195 201 KWQDLPP 207 (429)
Q Consensus 201 ~W~~~~~ 207 (429)
+...+..
T Consensus 283 ~~~~lt~ 289 (429)
T PRK01742 283 TPSQLTS 289 (429)
T ss_pred CeEeecc
Confidence 7776653
No 171
>PRK04043 tolB translocation protein TolB; Provisional
Probab=38.14 E-value=4e+02 Score=26.18 Aligned_cols=191 Identities=10% Similarity=-0.009 Sum_probs=94.9
Q ss_pred eEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEE
Q 014195 139 HVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQ 218 (429)
Q Consensus 139 ~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~ 218 (429)
+++++|+.+++=+.+...+. .-........+.+|.+.-...+ ..++|.+|..+.+++++...+..-......
T Consensus 214 ~Iyv~dl~tg~~~~lt~~~g--~~~~~~~SPDG~~la~~~~~~g------~~~Iy~~dl~~g~~~~LT~~~~~d~~p~~S 285 (419)
T PRK04043 214 TLYKYNLYTGKKEKIASSQG--MLVVSDVSKDGSKLLLTMAPKG------QPDIYLYDTNTKTLTQITNYPGIDVNGNFV 285 (419)
T ss_pred EEEEEECCCCcEEEEecCCC--cEEeeEECCCCCEEEEEEccCC------CcEEEEEECCCCcEEEcccCCCccCccEEC
Confidence 69999999887777765433 1111222233446665543221 468999999999999887544311112211
Q ss_pred EECCEEEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccc
Q 014195 219 LWRGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFK 298 (429)
Q Consensus 219 ~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~ 298 (429)
.-+.+||+.-...+ ..+.|.+. ..+.+.+++..... .. ....-+++-+++-........
T Consensus 286 PDG~~I~F~Sdr~g-----~~~Iy~~d-----l~~g~~~rlt~~g~--~~-~~~SPDG~~Ia~~~~~~~~~~-------- 344 (419)
T PRK04043 286 EDDKRIVFVSDRLG-----YPNIFMKK-----LNSGSVEQVVFHGK--NN-SSVSTYKNYIVYSSRETNNEF-------- 344 (419)
T ss_pred CCCCEEEEEECCCC-----CceEEEEE-----CCCCCeEeCccCCC--cC-ceECCCCCEEEEEEcCCCccc--------
Confidence 22446666644321 13444432 44555544332211 11 233335553333322211000
Q ss_pred cccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeE
Q 014195 299 CSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWH 376 (429)
Q Consensus 299 ~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~ 376 (429)
.....+++.+| ++..++.+.... .. ... ....||+.+++-..... ...++.++.+.+.=.
T Consensus 345 -----~~~~~~I~v~d~~~g~~~~LT~~~--~~-~~p-~~SPDG~~I~f~~~~~~---------~~~L~~~~l~g~~~~ 405 (419)
T PRK04043 345 -----GKNTFNLYLISTNSDYIRRLTANG--VN-QFP-RFSSDGGSIMFIKYLGN---------QSALGIIRLNYNKSF 405 (419)
T ss_pred -----CCCCcEEEEEECCCCCeEECCCCC--Cc-CCe-EECCCCCEEEEEEccCC---------cEEEEEEecCCCeeE
Confidence 00123588888 788888887532 11 122 24566665555433222 126888888765433
No 172
>PF05262 Borrelia_P83: Borrelia P83/100 protein; InterPro: IPR007926 This family consists of several Borrelia P83/P100 antigen proteins.
Probab=37.45 E-value=2.3e+02 Score=28.50 Aligned_cols=87 Identities=8% Similarity=-0.025 Sum_probs=52.8
Q ss_pred CCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCC
Q 014195 133 IDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPR 212 (429)
Q Consensus 133 ~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r 212 (429)
++..++.++.+|+.++.=-.-.++.. -.+..+...++.+.+++|..+... -.+...|+.+-+-..-+.-+..+
T Consensus 370 ~~~~ls~LvllD~~tg~~l~~S~~~~---Ir~r~~~~~~~~~vaI~g~~G~~~----ikLvlid~~tLev~kes~~~i~~ 442 (489)
T PF05262_consen 370 PNHYLSELVLLDSDTGDTLKRSPVNG---IRGRTFYEREDDLVAIAGCSGNAA----IKLVLIDPETLEVKKESEDEISW 442 (489)
T ss_pred CCCcceeEEEEeCCCCceecccccce---eccceeEEcCCCEEEEeccCCchh----eEEEecCcccceeeeeccccccc
Confidence 34457889999999986555455544 223455577888889998855442 23444477776655544444333
Q ss_pred CCceEEEECCEEEEE
Q 014195 213 YAPATQLWRGRLHVM 227 (429)
Q Consensus 213 ~~~~~~~~~~~lyv~ 227 (429)
.. .+...++.+|++
T Consensus 443 ~S-~l~~~~~~iyaV 456 (489)
T PF05262_consen 443 QS-SLIVDGQMIYAV 456 (489)
T ss_pred cC-ceEEcCCeEEEE
Confidence 32 445556777755
No 173
>PRK01742 tolB translocation protein TolB; Provisional
Probab=37.33 E-value=4.1e+02 Score=26.06 Aligned_cols=79 Identities=10% Similarity=0.058 Sum_probs=37.5
Q ss_pred CCEE-EEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 121 KNLL-YVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 121 ~~~i-yv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
+.+| |+.--.++.. ...+++.|.....=..+..... .-......-.+.+|. +..... . ...++.+|..+
T Consensus 168 ~~ria~v~~~~~~~~--~~~i~i~d~dg~~~~~lt~~~~--~v~~p~wSPDG~~la-~~s~~~-~----~~~i~i~dl~t 237 (429)
T PRK01742 168 RTRIAYVVQKNGGSQ--PYEVRVADYDGFNQFIVNRSSQ--PLMSPAWSPDGSKLA-YVSFEN-K----KSQLVVHDLRS 237 (429)
T ss_pred CCEEEEEEEEcCCCc--eEEEEEECCCCCCceEeccCCC--ccccceEcCCCCEEE-EEEecC-C----CcEEEEEeCCC
Confidence 4555 6543222221 2468888876544222222211 112222223344443 433221 1 35789999988
Q ss_pred CceEeCCCCC
Q 014195 200 KKWQDLPPLP 209 (429)
Q Consensus 200 ~~W~~~~~~p 209 (429)
.+-+.+...+
T Consensus 238 g~~~~l~~~~ 247 (429)
T PRK01742 238 GARKVVASFR 247 (429)
T ss_pred CceEEEecCC
Confidence 7766665443
No 174
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=37.05 E-value=2.3e+02 Score=24.32 Aligned_cols=55 Identities=13% Similarity=0.127 Sum_probs=31.1
Q ss_pred EEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceeeeeeEEECCEEEEEcc
Q 014195 337 VLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKTTLAGYWNGWLYFTSG 402 (429)
Q Consensus 337 ~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~~~~i~v~GG 402 (429)
-..+|+.++++|..... .++.+||.+ +.+.+.....+......-..+|+.++...
T Consensus 108 wsP~G~~l~~~g~~n~~---------G~l~~wd~~--~~~~i~~~~~~~~t~~~WsPdGr~~~ta~ 162 (194)
T PF08662_consen 108 WSPDGRFLVLAGFGNLN---------GDLEFWDVR--KKKKISTFEHSDATDVEWSPDGRYLATAT 162 (194)
T ss_pred ECCCCCEEEEEEccCCC---------cEEEEEECC--CCEEeeccccCcEEEEEEcCCCCEEEEEE
Confidence 44678899998876432 378999987 44455444333322222234455555443
No 175
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=36.97 E-value=6.2e+02 Score=28.05 Aligned_cols=31 Identities=10% Similarity=0.100 Sum_probs=26.5
Q ss_pred cEEEEecCCCCeEEecccCcceeeeeeEEEC
Q 014195 364 EIFQFNLNTLKWHVIGKLPYRVKTTLAGYWN 394 (429)
Q Consensus 364 ~i~~yd~~~~~W~~v~~lp~~r~~~~~~~~~ 394 (429)
...+|+++.|+...+..-|.+|.-.++..++
T Consensus 999 ~~~~y~~~~n~l~~fadD~~pR~Vt~~~~lD 1029 (1205)
T KOG1898|consen 999 HFVRYRREDNQLIVFADDPVPRHVTALELLD 1029 (1205)
T ss_pred EEEEEecCCCeEEEEeCCCccceeeEEEEec
Confidence 6789999999999999999999877766655
No 176
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=36.61 E-value=4.5e+02 Score=26.34 Aligned_cols=104 Identities=9% Similarity=0.036 Sum_probs=52.5
Q ss_pred hcceeeeecCCCcccceeeeeeecCCCCe----EEecCCCCCCCcceeeeecCCCCcCcccccccccccccCCCeEEccC
Q 014195 32 VADFFWASSSKFTSSYLNIASNWSPYHNS----IILPNNGPQKGENIGVKTKKDVVPKRILPATFQDLPAPELKWEKMKA 107 (429)
Q Consensus 32 ~~~~ly~~GG~~~~~~~~~~~~yd~~~~~----~~~p~~~~r~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~ 107 (429)
-++.-.++|| +.+++..||.++.+ .++++..+.+ ..++..........-.....+.++|...+. .+..
T Consensus 475 pdgrtLivGG-----eastlsiWDLAapTprikaeltssapaC-yALa~spDakvcFsccsdGnI~vwDLhnq~--~Vrq 546 (705)
T KOG0639|consen 475 PDGRTLIVGG-----EASTLSIWDLAAPTPRIKAELTSSAPAC-YALAISPDAKVCFSCCSDGNIAVWDLHNQT--LVRQ 546 (705)
T ss_pred CCCceEEecc-----ccceeeeeeccCCCcchhhhcCCcchhh-hhhhcCCccceeeeeccCCcEEEEEcccce--eeec
Confidence 3555567788 46688999987776 4444432322 122221111111111122334455555442 3445
Q ss_pred CCCCccCCcEEEEC--CEEEEEeccCCCCceeeeEEEEECCCCc
Q 014195 108 APVPRLDGAAIQIK--NLLYVFAGYGSIDYVHSHVDIYNFTDNT 149 (429)
Q Consensus 108 ~p~~R~~~~~~~~~--~~iyv~GG~~~~~~~~~~~~~yd~~~~~ 149 (429)
++..-.+.++..+. +.=+-.||.+ +.+.++|..+..
T Consensus 547 fqGhtDGascIdis~dGtklWTGGlD------ntvRcWDlregr 584 (705)
T KOG0639|consen 547 FQGHTDGASCIDISKDGTKLWTGGLD------NTVRCWDLREGR 584 (705)
T ss_pred ccCCCCCceeEEecCCCceeecCCCc------cceeehhhhhhh
Confidence 55555566666553 5445567764 346777776553
No 177
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=35.61 E-value=3.4e+02 Score=24.58 Aligned_cols=55 Identities=18% Similarity=0.238 Sum_probs=33.9
Q ss_pred EEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceee--eee-EEECCEEEEEcccCC
Q 014195 337 VLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKT--TLA-GYWNGWLYFTSGQRD 405 (429)
Q Consensus 337 ~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~--~~~-~~~~~~i~v~GG~~~ 405 (429)
...+..+||.||.+. .++.||-.++. +++.......+ |++ ...+|.+|..|-.+.
T Consensus 232 L~P~k~~fVaGged~------------~~~kfDy~Tge--Ei~~~nkgh~gpVhcVrFSPdGE~yAsGSEDG 289 (334)
T KOG0278|consen 232 LHPKKEFFVAGGEDF------------KVYKFDYNTGE--EIGSYNKGHFGPVHCVRFSPDGELYASGSEDG 289 (334)
T ss_pred ccCCCceEEecCcce------------EEEEEeccCCc--eeeecccCCCCceEEEEECCCCceeeccCCCc
Confidence 455678999999864 47778877764 23222222221 222 357899999977654
No 178
>PTZ00420 coronin; Provisional
Probab=35.07 E-value=5.2e+02 Score=26.64 Aligned_cols=58 Identities=17% Similarity=0.180 Sum_probs=28.8
Q ss_pred CEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEE-EECCEEEEEeCCCCCCCCccccceEe
Q 014195 172 RYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQ-LWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 172 ~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~-~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
..+++.||.+ ..+..||+.+.+=.. .+..+..-.++. ..++.+++.++.+ ..+..|++
T Consensus 138 ~~iLaSgS~D--------gtIrIWDl~tg~~~~--~i~~~~~V~SlswspdG~lLat~s~D-----~~IrIwD~ 196 (568)
T PTZ00420 138 YYIMCSSGFD--------SFVNIWDIENEKRAF--QINMPKKLSSLKWNIKGNLLSGTCVG-----KHMHIIDP 196 (568)
T ss_pred CeEEEEEeCC--------CeEEEEECCCCcEEE--EEecCCcEEEEEECCCCCEEEEEecC-----CEEEEEEC
Confidence 3455666643 356678887764111 111111112222 2367777777644 34666763
No 179
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=34.98 E-value=4e+02 Score=25.26 Aligned_cols=148 Identities=18% Similarity=0.203 Sum_probs=76.9
Q ss_pred eeeEEEEECCCCceeeCCC--CCCCC-ccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCC---CCCC
Q 014195 137 HSHVDIYNFTDNTWGGRFD--MPREM-AHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLP---PLPV 210 (429)
Q Consensus 137 ~~~~~~yd~~~~~W~~~~~--~~~~~-~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~---~~p~ 210 (429)
.+.+..|+...+.-+...+ ++... || |...--.+...|++.=.++ .-+++.||+...+.+++. .||.
T Consensus 166 ~Dri~~y~~~dg~L~~~~~~~v~~G~GPR-Hi~FHpn~k~aY~v~EL~s------tV~v~~y~~~~g~~~~lQ~i~tlP~ 238 (346)
T COG2706 166 TDRIFLYDLDDGKLTPADPAEVKPGAGPR-HIVFHPNGKYAYLVNELNS------TVDVLEYNPAVGKFEELQTIDTLPE 238 (346)
T ss_pred CceEEEEEcccCccccccccccCCCCCcc-eEEEcCCCcEEEEEeccCC------EEEEEEEcCCCceEEEeeeeccCcc
Confidence 3568889988777665432 21111 23 3333344567888854322 457888899888888875 3552
Q ss_pred C---CCCceEEEE---CCEEEEEeCCCCCCCCccccceEeeeecCCccccceee------ccCCCCCCCceeEEEeCCEE
Q 014195 211 P---RYAPATQLW---RGRLHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRT------EIPIPRGGPHRACVVVDDRL 278 (429)
Q Consensus 211 ~---r~~~~~~~~---~~~lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~------~~~~p~~~~~~~~~~~~~~i 278 (429)
. -...+++.+ +..||+.- +..++.-.|.++ +.+.+-+. ....||.- ....-++.|
T Consensus 239 dF~g~~~~aaIhis~dGrFLYasN-----Rg~dsI~~f~V~-----~~~g~L~~~~~~~teg~~PR~F---~i~~~g~~L 305 (346)
T COG2706 239 DFTGTNWAAAIHISPDGRFLYASN-----RGHDSIAVFSVD-----PDGGKLELVGITPTEGQFPRDF---NINPSGRFL 305 (346)
T ss_pred ccCCCCceeEEEECCCCCEEEEec-----CCCCeEEEEEEc-----CCCCEEEEEEEeccCCcCCccc---eeCCCCCEE
Confidence 2 122222222 45577773 333445555543 55444322 22234432 333334445
Q ss_pred EEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCC
Q 014195 279 LVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPS 324 (429)
Q Consensus 279 yv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~ 324 (429)
++. +.++.. -.+|.-| .+.+-+.+..
T Consensus 306 iaa-~q~sd~-------------------i~vf~~d~~TG~L~~~~~ 332 (346)
T COG2706 306 IAA-NQKSDN-------------------ITVFERDKETGRLTLLGR 332 (346)
T ss_pred EEE-ccCCCc-------------------EEEEEEcCCCceEEeccc
Confidence 544 443321 1367777 7777777654
No 180
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=34.71 E-value=4.9e+02 Score=26.19 Aligned_cols=101 Identities=14% Similarity=0.185 Sum_probs=52.7
Q ss_pred EEEEEeccCCCCceeeeEEEEECCCC-----ceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeC
Q 014195 123 LLYVFAGYGSIDYVHSHVDIYNFTDN-----TWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDT 197 (429)
Q Consensus 123 ~iyv~GG~~~~~~~~~~~~~yd~~~~-----~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~ 197 (429)
-=++.||++ .+|.+||.... ...++.+-... +.......+-++.|+|+-| ....-.||-
T Consensus 180 aR~~sGs~D------y~v~~wDf~gMdas~~~fr~l~P~E~h-~i~sl~ys~Tg~~iLvvsg---------~aqakl~DR 243 (641)
T KOG0772|consen 180 ARFVSGSLD------YTVKFWDFQGMDASMRSFRQLQPCETH-QINSLQYSVTGDQILVVSG---------SAQAKLLDR 243 (641)
T ss_pred ceeeecccc------ceEEEEecccccccchhhhccCccccc-ccceeeecCCCCeEEEEec---------CcceeEEcc
Confidence 345556554 34777776543 23333221110 1112233345888999877 345567888
Q ss_pred CCCceEeCC-------CCCCCCCCceEEEE-------CCEEEEEeCCCCCCCCccccceEee
Q 014195 198 ETKKWQDLP-------PLPVPRYAPATQLW-------RGRLHVMGGSGENRYTPEVDHWSLA 245 (429)
Q Consensus 198 ~t~~W~~~~-------~~p~~r~~~~~~~~-------~~~lyv~GG~~~~~~~~~~~~~~~~ 245 (429)
...+|.+.. +|.. --+|.+... +...|+..+.+ .+...|++.
T Consensus 244 dG~~~~e~~KGDQYI~Dm~n-TKGHia~lt~g~whP~~k~~FlT~s~D-----gtlRiWdv~ 299 (641)
T KOG0772|consen 244 DGFEIVEFSKGDQYIRDMYN-TKGHIAELTCGCWHPDNKEEFLTCSYD-----GTLRIWDVN 299 (641)
T ss_pred CCceeeeeeccchhhhhhhc-cCCceeeeeccccccCcccceEEecCC-----CcEEEEecC
Confidence 888887753 2322 233444332 23466665544 457777753
No 181
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=34.70 E-value=1.2e+02 Score=28.19 Aligned_cols=57 Identities=19% Similarity=0.151 Sum_probs=35.2
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCC----ccceeeEEEeCCEEEEE
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREM----AHSHLGMVTDGRYIYVV 177 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~----~r~~~~~~~~~~~lyv~ 177 (429)
-+.+-++||.+.+....+.+-++|-..+.-..-.....+. -|..+-++++.++|||+
T Consensus 58 ~N~laLVGGg~~pky~pNkviIWDD~k~~~i~el~f~~~I~~V~l~r~riVvvl~~~I~Vy 118 (346)
T KOG2111|consen 58 SNYLALVGGGSRPKYPPNKVIIWDDLKERCIIELSFNSEIKAVKLRRDRIVVVLENKIYVY 118 (346)
T ss_pred hceEEEecCCCCCCCCCceEEEEecccCcEEEEEEeccceeeEEEcCCeEEEEecCeEEEE
Confidence 4678888888877777888999994444322211111111 14455677777778776
No 182
>COG4447 Uncharacterized protein related to plant photosystem II stability/assembly factor [General function prediction only]
Probab=34.34 E-value=3.8e+02 Score=24.76 Aligned_cols=242 Identities=10% Similarity=0.025 Sum_probs=113.1
Q ss_pred cccccCCCeEEccCCCCCccC-CcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCC
Q 014195 94 DLPAPELKWEKMKAAPVPRLD-GAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGR 172 (429)
Q Consensus 94 ~~d~~~~~W~~~~~~p~~R~~-~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~ 172 (429)
.-|.....|++.-... .|.. |++..++.+=++.|- .+.++.=+-...+|.+++.-..+ +-.-.++..++.
T Consensus 68 etdd~g~tw~qal~~~-gr~~f~sv~f~~~egw~vGe-------~sqll~T~DgGqsWARi~~~e~~-eg~~~sI~f~d~ 138 (339)
T COG4447 68 ETDDGGITWAQALDFL-GRHAFHSVSFLGMEGWIVGE-------PSQLLHTTDGGQSWARIPLSEKL-EGFPDSITFLDD 138 (339)
T ss_pred EecCCcccchhhhchh-hhhheeeeeeecccccccCC-------cceEEEecCCCcchhhchhhcCC-CCCcceeEEecc
Confidence 3355667887643322 2444 333333444444431 23466666677899988643321 222334444433
Q ss_pred -EEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCC--CCCceEEEECCEEEEEeCCCCCCCCccccceEeeeecC
Q 014195 173 -YIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVP--RYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLAVKDG 249 (429)
Q Consensus 173 -~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~--r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~~~~~ 249 (429)
+-+++|- .-.++.=+---+.|+.+.+--.+ .-..-..+.+|+..++|-... -| ..|.
T Consensus 139 q~g~m~gd---------~Gail~T~DgGk~Wk~l~e~~v~~~~~n~ia~s~dng~vaVg~rGs-~f----~T~~------ 198 (339)
T COG4447 139 QRGEMLGD---------QGAILKTTDGGKNWKALVEKAVGLAVPNEIARSADNGYVAVGARGS-FF----STWG------ 198 (339)
T ss_pred hhhhhhcc---------cceEEEecCCcccHhHhcccccchhhhhhhhhhccCCeEEEecCcc-eE----ecCC------
Confidence 4444443 22444444455679887643222 222233345667777764331 11 1111
Q ss_pred CccccceeeccCCCCCCCceeEEEeCC--EEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCC-
Q 014195 250 KPLEKEWRTEIPIPRGGPHRACVVVDD--RLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSM- 325 (429)
Q Consensus 250 d~~~~~W~~~~~~p~~~~~~~~~~~~~--~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~- 325 (429)
+....|..-.+-...+...-...-++ -+++.||... .+... ..+.|+.++..
T Consensus 199 -aGqt~~~~~g~~s~~~letmg~adag~~g~la~g~qg~-----------------------~f~~~~~gD~wsd~~~~~ 254 (339)
T COG4447 199 -AGQTVWLPHGRNSSRRLETMGLADAGSKGLLARGGQGD-----------------------QFSWVCGGDEWSDQGEPV 254 (339)
T ss_pred -CCccEEeccCCCccchhcccccccCCccceEEEccccc-----------------------eeecCCCcccccccccch
Confidence 22223332222111111111122233 3777787631 23333 68899987632
Q ss_pred CCCCCCccee--EEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCccee-eee-eEEECCEEEEEc
Q 014195 326 PKPDSHIEFA--WVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVK-TTL-AGYWNGWLYFTS 401 (429)
Q Consensus 326 ~~~r~~~~~~--~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~-~~~-~~~~~~~i~v~G 401 (429)
...|...+.. ...-.+.+||.|.-. ++..=.-...+|++....+...+ .+. ...-.++.+++|
T Consensus 255 ~~g~~~~Gl~d~a~~a~~~v~v~G~gG-------------nvl~StdgG~t~skd~g~~er~s~l~~V~~ts~~~~~l~G 321 (339)
T COG4447 255 NLGRRSWGLLDFAPRAPPEVWVSGIGG-------------NVLASTDGGTTWSKDGGVEERVSNLYSVVFTSPKAGFLCG 321 (339)
T ss_pred hcccCCCccccccccCCCCeEEeccCc-------------cEEEecCCCeeEeccCChhhhhhhhheEEeccCCceEEEc
Confidence 1111111110 134578899998722 33333334567887655544333 222 334556777775
No 183
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=31.29 E-value=4.4e+02 Score=24.63 Aligned_cols=62 Identities=21% Similarity=0.408 Sum_probs=32.2
Q ss_pred CCCeEEcCC---C--CCCCCCcceeEEEEC-----CEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccC
Q 014195 316 EMKWKVLPS---M--PKPDSHIEFAWVLVN-----NSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLP 382 (429)
Q Consensus 316 ~~~W~~~~~---~--~~~r~~~~~~~~~~~-----~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp 382 (429)
...|+.... + |..+....++++..+ ..++.+|-.......+ ...||.|+-..++|.++..||
T Consensus 149 Ls~W~Lq~Ei~~~~~pp~~~~~~~~CvsWn~sr~~~p~iAvgs~e~a~~~~-----~~~Iye~~e~~rKw~kva~L~ 220 (361)
T KOG2445|consen 149 LSQWTLQHEIQNVIDPPGKNKQPCFCVSWNPSRMHEPLIAVGSDEDAPHLN-----KVKIYEYNENGRKWLKVAELP 220 (361)
T ss_pred cccchhhhhhhhccCCcccccCcceEEeeccccccCceEEEEcccCCcccc-----ceEEEEecCCcceeeeehhcC
Confidence 457875532 2 222333233334443 3566666544222111 124677777778999987654
No 184
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=31.22 E-value=4.2e+02 Score=24.29 Aligned_cols=167 Identities=10% Similarity=0.027 Sum_probs=0.0
Q ss_pred eeeeeecCCCCe--EEecCCCCCCCcceeeeecCCCCcCcc---ccccccccccc-------CCCeEEccCCCCCccCCc
Q 014195 49 NIASNWSPYHNS--IILPNNGPQKGENIGVKTKKDVVPKRI---LPATFQDLPAP-------ELKWEKMKAAPVPRLDGA 116 (429)
Q Consensus 49 ~~~~~yd~~~~~--~~~p~~~~r~~~~~~~~~~~~~~~~~~---~~~~~~~~d~~-------~~~W~~~~~~p~~R~~~~ 116 (429)
+++..||-++.+ ..++...+-..............+.+. ....+..||.+ .++=...-++|....--+
T Consensus 74 ~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a 153 (327)
T KOG0643|consen 74 QTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSA 153 (327)
T ss_pred ceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeee
Q ss_pred EEEECCEEEEEeccCCCCceeeeEEEEECCCC-ceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEE
Q 014195 117 AIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDN-TWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVL 195 (429)
Q Consensus 117 ~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~-~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~y 195 (429)
+-..-++.+|.|..++. +-.||..++ +-........ ....--...-+...||.|-. -+..-.+
T Consensus 154 ~Wg~l~~~ii~Ghe~G~------is~~da~~g~~~v~s~~~h~--~~Ind~q~s~d~T~FiT~s~--------Dttakl~ 217 (327)
T KOG0643|consen 154 LWGPLGETIIAGHEDGS------ISIYDARTGKELVDSDEEHS--SKINDLQFSRDRTYFITGSK--------DTTAKLV 217 (327)
T ss_pred eecccCCEEEEecCCCc------EEEEEcccCceeeechhhhc--cccccccccCCcceEEeccc--------Cccceee
Q ss_pred eCCCCceEeCCCCCCCCCCceEEEECCEEEEEeCCC
Q 014195 196 DTETKKWQDLPPLPVPRYAPATQLWRGRLHVMGGSG 231 (429)
Q Consensus 196 d~~t~~W~~~~~~p~~r~~~~~~~~~~~lyv~GG~~ 231 (429)
|..+-+-.+.-.-..|....++..+.+.+.+-||.+
T Consensus 218 D~~tl~v~Kty~te~PvN~aaisP~~d~VilgGGqe 253 (327)
T KOG0643|consen 218 DVRTLEVLKTYTTERPVNTAAISPLLDHVILGGGQE 253 (327)
T ss_pred eccceeeEEEeeecccccceecccccceEEecCCce
No 185
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=29.13 E-value=4.3e+02 Score=23.76 Aligned_cols=132 Identities=8% Similarity=0.038 Sum_probs=73.3
Q ss_pred eeeeecCCCCe-EEecCCCCCCCcceeeeecC--CCCcCcccccccccccccCCCeEEccCCCCCccCCcEEEECC--EE
Q 014195 50 IASNWSPYHNS-IILPNNGPQKGENIGVKTKK--DVVPKRILPATFQDLPAPELKWEKMKAAPVPRLDGAAIQIKN--LL 124 (429)
Q Consensus 50 ~~~~yd~~~~~-~~~p~~~~r~~~~~~~~~~~--~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~R~~~~~~~~~~--~i 124 (429)
++-.|||.... +.--+.+.+.-+-++..... ...|+ -..++..+|..+++-.+ .+...-..--++.+++ .+
T Consensus 40 tvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~G--gDk~v~vwDV~TGkv~R--r~rgH~aqVNtV~fNeesSV 115 (307)
T KOG0316|consen 40 TVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCG--GDKAVQVWDVNTGKVDR--RFRGHLAQVNTVRFNEESSV 115 (307)
T ss_pred eEEeecccccceeeeecCCCceeeeccccccccccccCC--CCceEEEEEcccCeeee--ecccccceeeEEEecCcceE
Confidence 66778887777 44444322222222222222 22333 33455666666653211 0000001111233443 56
Q ss_pred EEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCc
Q 014195 125 YVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKK 201 (429)
Q Consensus 125 yv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~ 201 (429)
++-|+.+ .++.++|...++-+.+.-+.. .+.....+.+.+..+|.|-.++ .+-.||....+
T Consensus 116 v~SgsfD------~s~r~wDCRS~s~ePiQilde--a~D~V~Si~v~~heIvaGS~DG--------tvRtydiR~G~ 176 (307)
T KOG0316|consen 116 VASGSFD------SSVRLWDCRSRSFEPIQILDE--AKDGVSSIDVAEHEIVAGSVDG--------TVRTYDIRKGT 176 (307)
T ss_pred EEecccc------ceeEEEEcccCCCCccchhhh--hcCceeEEEecccEEEeeccCC--------cEEEEEeecce
Confidence 6666654 458899999999988877776 6777777888888887776544 45568776554
No 186
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=28.83 E-value=3.4e+02 Score=26.88 Aligned_cols=81 Identities=15% Similarity=0.168 Sum_probs=40.7
Q ss_pred CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCceEEEE---CCEEEEEeCCCCCCCCccccceEee--
Q 014195 171 GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAPATQLW---RGRLHVMGGSGENRYTPEVDHWSLA-- 245 (429)
Q Consensus 171 ~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~~~~~~---~~~lyv~GG~~~~~~~~~~~~~~~~-- 245 (429)
.+.=|+..|++. .+-.+|.+|++-..--.+- .-..++-. +..+|++||.+. .+..|++.
T Consensus 269 ~g~~fLS~sfD~--------~lKlwDtETG~~~~~f~~~---~~~~cvkf~pd~~n~fl~G~sd~-----ki~~wDiRs~ 332 (503)
T KOG0282|consen 269 CGTSFLSASFDR--------FLKLWDTETGQVLSRFHLD---KVPTCVKFHPDNQNIFLVGGSDK-----KIRQWDIRSG 332 (503)
T ss_pred cCCeeeeeecce--------eeeeeccccceEEEEEecC---CCceeeecCCCCCcEEEEecCCC-----cEEEEeccch
Confidence 344455555533 3445788887654321111 11112211 358999999874 34445532
Q ss_pred --eecCCccccceeeccCCCCCCC
Q 014195 246 --VKDGKPLEKEWRTEIPIPRGGP 267 (429)
Q Consensus 246 --~~~~d~~~~~W~~~~~~p~~~~ 267 (429)
+..||..-..|..+.-++..+.
T Consensus 333 kvvqeYd~hLg~i~~i~F~~~g~r 356 (503)
T KOG0282|consen 333 KVVQEYDRHLGAILDITFVDEGRR 356 (503)
T ss_pred HHHHHHHhhhhheeeeEEccCCce
Confidence 3444455555555555555543
No 187
>COG4447 Uncharacterized protein related to plant photosystem II stability/assembly factor [General function prediction only]
Probab=27.67 E-value=4.9e+02 Score=24.03 Aligned_cols=140 Identities=14% Similarity=0.261 Sum_probs=73.8
Q ss_pred CCcEEEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeE
Q 014195 114 DGAAIQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTF 193 (429)
Q Consensus 114 ~~~~~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~ 193 (429)
.-+.+.-+++.+++|+.. .+..=|-..++|++.-..-. +...+++.+.+.+=+++|= -+.++
T Consensus 47 ~ia~~~~g~~gwlVg~rg-------tiletdd~g~tw~qal~~~g--r~~f~sv~f~~~egw~vGe---------~sqll 108 (339)
T COG4447 47 DIAFTESGSHGWLVGGRG-------TILETDDGGITWAQALDFLG--RHAFHSVSFLGMEGWIVGE---------PSQLL 108 (339)
T ss_pred ceeEeecCcceEEEcCcc-------eEEEecCCcccchhhhchhh--hhheeeeeeecccccccCC---------cceEE
Confidence 344455578899999853 24455666788987533221 2234444445554555542 45666
Q ss_pred EEeCCCCceEeCC-CCCCCCCCceEEEECCE-EEEEeCCCCCCCCccccceEeeeecCCccccceeeccCCCCC--CCce
Q 014195 194 VLDTETKKWQDLP-PLPVPRYAPATQLWRGR-LHVMGGSGENRYTPEVDHWSLAVKDGKPLEKEWRTEIPIPRG--GPHR 269 (429)
Q Consensus 194 ~yd~~t~~W~~~~-~~p~~r~~~~~~~~~~~-lyv~GG~~~~~~~~~~~~~~~~~~~~d~~~~~W~~~~~~p~~--~~~~ 269 (429)
.=+-.-++|.+++ +...+-.-.++..++++ -|++|-.. - ++..+...+.|+.+.+-... ....
T Consensus 109 ~T~DgGqsWARi~~~e~~eg~~~sI~f~d~q~g~m~gd~G--------a-----il~T~DgGk~Wk~l~e~~v~~~~~n~ 175 (339)
T COG4447 109 HTTDGGQSWARIPLSEKLEGFPDSITFLDDQRGEMLGDQG--------A-----ILKTTDGGKNWKALVEKAVGLAVPNE 175 (339)
T ss_pred EecCCCcchhhchhhcCCCCCcceeEEecchhhhhhcccc--------e-----EEEecCCcccHhHhcccccchhhhhh
Confidence 6677788999986 22233333445555443 34444321 1 11112456678875443222 1122
Q ss_pred eEEEeCCEEEEEccc
Q 014195 270 ACVVVDDRLLVIGGQ 284 (429)
Q Consensus 270 ~~~~~~~~iyv~GG~ 284 (429)
.+...++...++|-.
T Consensus 176 ia~s~dng~vaVg~r 190 (339)
T COG4447 176 IARSADNGYVAVGAR 190 (339)
T ss_pred hhhhccCCeEEEecC
Confidence 344556666666654
No 188
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=27.45 E-value=6.2e+02 Score=25.11 Aligned_cols=88 Identities=10% Similarity=0.027 Sum_probs=45.8
Q ss_pred eEEEEECCCC-ce-eeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCCc
Q 014195 139 HVDIYNFTDN-TW-GGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYAP 215 (429)
Q Consensus 139 ~~~~yd~~~~-~W-~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~~ 215 (429)
.+.++|...+ .- ..+..... .. ++++.. .+.+++.|+.+ ..+..+|..+.+-...-.........
T Consensus 226 tiriwd~~~~~~~~~~l~gH~~--~v--~~~~f~p~g~~i~Sgs~D--------~tvriWd~~~~~~~~~l~~hs~~is~ 293 (456)
T KOG0266|consen 226 TLRIWDLKDDGRNLKTLKGHST--YV--TSVAFSPDGNLLVSGSDD--------GTVRIWDVRTGECVRKLKGHSDGISG 293 (456)
T ss_pred eEEEeeccCCCeEEEEecCCCC--ce--EEEEecCCCCEEEEecCC--------CcEEEEeccCCeEEEeeeccCCceEE
Confidence 4788888444 22 23333333 23 333332 44788888753 46778888885443332222222222
Q ss_pred eEEEECCEEEEEeCCCCCCCCccccceE
Q 014195 216 ATQLWRGRLHVMGGSGENRYTPEVDHWS 243 (429)
Q Consensus 216 ~~~~~~~~lyv~GG~~~~~~~~~~~~~~ 243 (429)
.+..-++.+++.+..+ .....|+
T Consensus 294 ~~f~~d~~~l~s~s~d-----~~i~vwd 316 (456)
T KOG0266|consen 294 LAFSPDGNLLVSASYD-----GTIRVWD 316 (456)
T ss_pred EEECCCCCEEEEcCCC-----ccEEEEE
Confidence 2223366777776543 4567776
No 189
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=25.36 E-value=6.9e+02 Score=24.95 Aligned_cols=72 Identities=8% Similarity=0.164 Sum_probs=42.9
Q ss_pred EEECCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeC
Q 014195 118 IQIKNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDT 197 (429)
Q Consensus 118 ~~~~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~ 197 (429)
+.++++||.+.-.++-++ ++.-|...+.-.+-.+...--+|.. --+++=.||-- -.++|.|||
T Consensus 232 mIV~~RvYFlsD~eG~Gn----lYSvdldGkDlrrHTnFtdYY~R~~----nsDGkrIvFq~---------~GdIylydP 294 (668)
T COG4946 232 MIVGERVYFLSDHEGVGN----LYSVDLDGKDLRRHTNFTDYYPRNA----NSDGKRIVFQN---------AGDIYLYDP 294 (668)
T ss_pred eEEcceEEEEecccCccc----eEEeccCCchhhhcCCchhcccccc----CCCCcEEEEec---------CCcEEEeCC
Confidence 456889998876665543 5556666665555444443223321 22444444410 248999999
Q ss_pred CCCceEeCC
Q 014195 198 ETKKWQDLP 206 (429)
Q Consensus 198 ~t~~W~~~~ 206 (429)
+++.-+++.
T Consensus 295 ~td~lekld 303 (668)
T COG4946 295 ETDSLEKLD 303 (668)
T ss_pred CcCcceeee
Confidence 999888774
No 190
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=25.26 E-value=5.7e+02 Score=23.93 Aligned_cols=117 Identities=14% Similarity=0.136 Sum_probs=0.0
Q ss_pred CCCCCCCceeEEEeCCEEEEEcccCCCCCCCCCCCccccccCCeeeeCceEEeC-CCCCeEEcCCCCCCCCCcceeEEEE
Q 014195 261 PIPRGGPHRACVVVDDRLLVIGGQEGDFMAKPGSPIFKCSRRNEVVYDDVYMLD-DEMKWKVLPSMPKPDSHIEFAWVLV 339 (429)
Q Consensus 261 ~~p~~~~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~d-~~~~W~~~~~~~~~r~~~~~~~~~~ 339 (429)
++|...+..++-.....+.+|+=.-+.. .+.+| .+.+=...-..+..|...++++...
T Consensus 2 ~lP~RgH~~a~~p~~~~avafaRRPG~~---------------------~~v~D~~~g~~~~~~~a~~gRHFyGHg~fs~ 60 (305)
T PF07433_consen 2 PLPARGHGVAAHPTRPEAVAFARRPGTF---------------------ALVFDCRTGQLLQRLWAPPGRHFYGHGVFSP 60 (305)
T ss_pred CCCccccceeeCCCCCeEEEEEeCCCcE---------------------EEEEEcCCCceeeEEcCCCCCEEecCEEEcC
Q ss_pred CCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCeEEecccCcceee-eeeEEECCE--EEEEcccCCCCCCC
Q 014195 340 NNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKWHVIGKLPYRVKT-TLAGYWNGW--LYFTSGQRDKGPDD 410 (429)
Q Consensus 340 ~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W~~v~~lp~~r~~-~~~~~~~~~--i~v~GG~~~~~~~~ 410 (429)
+++.+..--.+.... ..-|=+||.. +....+++.+..-.. |.+....+- |.|.-| |+.|
T Consensus 61 dG~~LytTEnd~~~g-------~G~IgVyd~~-~~~~ri~E~~s~GIGPHel~l~pDG~tLvVANG----GI~T 122 (305)
T PF07433_consen 61 DGRLLYTTENDYETG-------RGVIGVYDAA-RGYRRIGEFPSHGIGPHELLLMPDGETLVVANG----GIET 122 (305)
T ss_pred CCCEEEEeccccCCC-------cEEEEEEECc-CCcEEEeEecCCCcChhhEEEcCCCCEEEEEcC----CCcc
No 191
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=24.66 E-value=3.5e+02 Score=27.46 Aligned_cols=78 Identities=10% Similarity=0.137 Sum_probs=43.7
Q ss_pred eEEeC-CCCCeEEcC--CCCCCCCCcceeEEEECCEEEEEcccCCCCCCccceeeeCcEEEEecCCCCe--EEecccCcc
Q 014195 310 VYMLD-DEMKWKVLP--SMPKPDSHIEFAWVLVNNSIVIVGGTTEKHPTTKKMVLVGEIFQFNLNTLKW--HVIGKLPYR 384 (429)
Q Consensus 310 v~~~d-~~~~W~~~~--~~~~~r~~~~~~~~~~~~~i~v~GG~~~~~~~~~~~~~~~~i~~yd~~~~~W--~~v~~lp~~ 384 (429)
...|+ ..++-+.+. ..|.+-.- .+++...+...+++|-.++ .|-.||..+..= .+.+-+|.-
T Consensus 238 ~ciYE~~r~klqrvsvtsipL~s~v-~~ca~sp~E~kLvlGC~Dg------------SiiLyD~~~~~t~~~ka~~~P~~ 304 (545)
T PF11768_consen 238 SCIYECSRNKLQRVSVTSIPLPSQV-ICCARSPSEDKLVLGCEDG------------SIILYDTTRGVTLLAKAEFIPTL 304 (545)
T ss_pred EEEEEeecCceeEEEEEEEecCCcc-eEEecCcccceEEEEecCC------------eEEEEEcCCCeeeeeeecccceE
Confidence 34444 555555443 33333222 2333556678899998764 688899877643 222223333
Q ss_pred eeeeeeEEECCEEEEEcccC
Q 014195 385 VKTTLAGYWNGWLYFTSGQR 404 (429)
Q Consensus 385 r~~~~~~~~~~~i~v~GG~~ 404 (429)
.+.| .+|.++++|+..
T Consensus 305 iaWH----p~gai~~V~s~q 320 (545)
T PF11768_consen 305 IAWH----PDGAIFVVGSEQ 320 (545)
T ss_pred EEEc----CCCcEEEEEcCC
Confidence 3333 478888888753
No 192
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=24.58 E-value=4.6e+02 Score=27.52 Aligned_cols=102 Identities=14% Similarity=0.145 Sum_probs=52.8
Q ss_pred CCEEEEEeccCCCCceeeeEEEEECCCCceeeCCCCCCCCccceeeEEEe-CCEEEEEeCeeCCCCCCCCceeEEEeCCC
Q 014195 121 KNLLYVFAGYGSIDYVHSHVDIYNFTDNTWGGRFDMPREMAHSHLGMVTD-GRYIYVVTGQYGPQCRGPTAHTFVLDTET 199 (429)
Q Consensus 121 ~~~iyv~GG~~~~~~~~~~~~~yd~~~~~W~~~~~~~~~~~r~~~~~~~~-~~~lyv~GG~~~~~~~~~~~~~~~yd~~t 199 (429)
.|.-|+++|... ..|-.+|..+..-.++-.-.. +.-.++++- .++-.+.|+. ...+-.||..+
T Consensus 545 PNs~Y~aTGSsD-----~tVRlWDv~~G~~VRiF~GH~---~~V~al~~Sp~Gr~LaSg~e--------d~~I~iWDl~~ 608 (707)
T KOG0263|consen 545 PNSNYVATGSSD-----RTVRLWDVSTGNSVRIFTGHK---GPVTALAFSPCGRYLASGDE--------DGLIKIWDLAN 608 (707)
T ss_pred CcccccccCCCC-----ceEEEEEcCCCcEEEEecCCC---CceEEEEEcCCCceEeeccc--------CCcEEEEEcCC
Confidence 466677776322 236667777666555433222 112233332 4444444443 23566677766
Q ss_pred CceEeCCCCC--CCCCCceEEEECCEEEEEeCCCCCCCCccccceEee
Q 014195 200 KKWQDLPPLP--VPRYAPATQLWRGRLHVMGGSGENRYTPEVDHWSLA 245 (429)
Q Consensus 200 ~~W~~~~~~p--~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~~ 245 (429)
.+-. ..+- ..-...-....+|.+++.||.+ +++..|++.
T Consensus 609 ~~~v--~~l~~Ht~ti~SlsFS~dg~vLasgg~D-----nsV~lWD~~ 649 (707)
T KOG0263|consen 609 GSLV--KQLKGHTGTIYSLSFSRDGNVLASGGAD-----NSVRLWDLT 649 (707)
T ss_pred Ccch--hhhhcccCceeEEEEecCCCEEEecCCC-----CeEEEEEch
Confidence 4311 1111 1111112224589999999976 578889864
No 193
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=24.30 E-value=5.3e+02 Score=23.35 Aligned_cols=56 Identities=13% Similarity=0.228 Sum_probs=34.6
Q ss_pred EEEECCCCceee--CCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCC-ceEeCCC
Q 014195 141 DIYNFTDNTWGG--RFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETK-KWQDLPP 207 (429)
Q Consensus 141 ~~yd~~~~~W~~--~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~-~W~~~~~ 207 (429)
|.-+.+.++|+. +.+.|. +-.+.+-...++.|-|-|| .+.+.++-...+ +|.++..
T Consensus 238 wt~~~e~e~wk~tll~~f~~--~~w~vSWS~sGn~LaVs~G---------dNkvtlwke~~~Gkw~~v~~ 296 (299)
T KOG1332|consen 238 WTKDEEYEPWKKTLLEEFPD--VVWRVSWSLSGNILAVSGG---------DNKVTLWKENVDGKWEEVGE 296 (299)
T ss_pred EEecCccCcccccccccCCc--ceEEEEEeccccEEEEecC---------CcEEEEEEeCCCCcEEEccc
Confidence 334445677864 345555 4445555556776666666 566777766654 8998864
No 194
>PF07734 FBA_1: F-box associated; InterPro: IPR006527 This domain occurs in a diverse superfamily of genes in plants. Most examples are found C-terminal to an F-box (IPR001810 from INTERPRO), a 60 amino acid motif involved in ubiquitination of target proteins to mark them for degradation. Two-hybid experiments support the idea that most members are interchangeable F-box subunits of SCF E3 complexes []. Some members have two copies of this domain.
Probab=23.06 E-value=4.3e+02 Score=21.75 Aligned_cols=83 Identities=14% Similarity=0.153 Sum_probs=0.0
Q ss_pred EEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCC-CceEEEE----CCEEEEEeCCCCCCCCccccce
Q 014195 168 VTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRY-APATQLW----RGRLHVMGGSGENRYTPEVDHW 242 (429)
Q Consensus 168 ~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~-~~~~~~~----~~~lyv~GG~~~~~~~~~~~~~ 242 (429)
+.++|.+|=+.-...... ..-+..||..+.+.....++|.... ....+.+ +++|-++ .........+.|
T Consensus 2 V~vnG~~hW~~~~~~~~~---~~~IlsFDl~~E~F~~~~~lP~~~~~~~~~~~L~~v~~~~L~~~---~~~~~~~~~~IW 75 (164)
T PF07734_consen 2 VFVNGALHWLAYDENNDE---KDFILSFDLSTEKFGRSLPLPFCNDDDDDSVSLSVVRGDCLCVL---YQCDETSKIEIW 75 (164)
T ss_pred EEECCEEEeeEEecCCCC---ceEEEEEeccccccCCEECCCCccCccCCEEEEEEecCCEEEEE---EeccCCccEEEE
Q ss_pred EeeeecCCccccceee
Q 014195 243 SLAVKDGKPLEKEWRT 258 (429)
Q Consensus 243 ~~~~~~~d~~~~~W~~ 258 (429)
...-+.+. ...|++
T Consensus 76 vm~~~~~~--~~SWtK 89 (164)
T PF07734_consen 76 VMKKYGYG--KESWTK 89 (164)
T ss_pred EEeeeccC--cceEEE
No 195
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=21.21 E-value=8e+02 Score=24.15 Aligned_cols=91 Identities=12% Similarity=0.131 Sum_probs=49.1
Q ss_pred EEEEECCCC---ceeeCCCCCCCCccceeeEEEeCCEEEEEeCeeCCCCCCCCceeEEEeCCCCceEeCCCCCCCCCC-c
Q 014195 140 VDIYNFTDN---TWGGRFDMPREMAHSHLGMVTDGRYIYVVTGQYGPQCRGPTAHTFVLDTETKKWQDLPPLPVPRYA-P 215 (429)
Q Consensus 140 ~~~yd~~~~---~W~~~~~~~~~~~r~~~~~~~~~~~lyv~GG~~~~~~~~~~~~~~~yd~~t~~W~~~~~~p~~r~~-~ 215 (429)
++-||.... .|+..+.-. +.++.++-...-.+.+.++.++ .-.+|.++....+-..-..|...|.. +
T Consensus 354 v~~~D~R~~~~~vwt~~AHd~---~ISgl~~n~~~p~~l~t~s~d~------~Vklw~~~~~~~~~v~~~~~~~~rl~c~ 424 (463)
T KOG0270|consen 354 VYYFDIRNPGKPVWTLKAHDD---EISGLSVNIQTPGLLSTASTDK------VVKLWKFDVDSPKSVKEHSFKLGRLHCF 424 (463)
T ss_pred EEeeecCCCCCceeEEEeccC---CcceEEecCCCCcceeeccccc------eEEEEeecCCCCcccccccccccceeec
Confidence 667777665 465543221 1223333333334555554332 44667777766666666667777722 2
Q ss_pred eEEEECCEEEEEeCCCCCCCCccccceEe
Q 014195 216 ATQLWRGRLHVMGGSGENRYTPEVDHWSL 244 (429)
Q Consensus 216 ~~~~~~~~lyv~GG~~~~~~~~~~~~~~~ 244 (429)
+.......+|++||... ...+|++
T Consensus 425 ~~~~~~a~~la~GG~k~-----~~~vwd~ 448 (463)
T KOG0270|consen 425 ALDPDVAFTLAFGGEKA-----VLRVWDI 448 (463)
T ss_pred ccCCCcceEEEecCccc-----eEEEeec
Confidence 22334567999999763 3455654
No 196
>PF03022 MRJP: Major royal jelly protein; InterPro: IPR003534 The major royal jelly proteins (MRJPs) comprise 12.5% of the mass, and 82-90% of the protein content [], of honeybee (Apis mellifera) royal jelly. Royal jelly is a substance secreted by the cephalic glands of nurse bees [] and it is used to trigger development of a queen bee from a bee larva. The biological function of the MRJPs is unknown, but they are believed to play a major role in nutrition due to their high essential amino acid content []. Two royal jelly proteins, MRJP3 and MRJP5, contain a tandem repeat that results from a high genetic variablility. This polymorphism may be useful for genotyping individual bees [].; PDB: 3Q6P_B 3Q6K_A 3Q6T_A 2QE8_B.
Probab=20.52 E-value=6.8e+02 Score=23.07 Aligned_cols=98 Identities=18% Similarity=0.275 Sum_probs=51.8
Q ss_pred CCEEEEEe-cc-CCCC----ceeeeEEEEECCCCceeeCCCCCCCC--ccce-eeEEEeC-------CEEEEEeCeeCCC
Q 014195 121 KNLLYVFA-GY-GSID----YVHSHVDIYNFTDNTWGGRFDMPREM--AHSH-LGMVTDG-------RYIYVVTGQYGPQ 184 (429)
Q Consensus 121 ~~~iyv~G-G~-~~~~----~~~~~~~~yd~~~~~W~~~~~~~~~~--~r~~-~~~~~~~-------~~lyv~GG~~~~~ 184 (429)
.+.|+|+= |. +... ....++..||+.+++=.+.-.+|... +.+. ..+++.. +.+||. +..
T Consensus 11 ~~rLWVlD~G~~~~~~~~~~~~~pKLv~~Dl~t~~li~~~~~p~~~~~~~s~lndl~VD~~~~~~~~~~aYIt---D~~- 86 (287)
T PF03022_consen 11 CGRLWVLDSGRPNGLQPPKQVCPPKLVAFDLKTNQLIRRYPFPPDIAPPDSFLNDLVVDVRDGNCDDGFAYIT---DSG- 86 (287)
T ss_dssp TSEEEEEE-CCHSSSSTTGHTS--EEEEEETTTTCEEEEEE--CCCS-TCGGEEEEEEECTTTTS-SEEEEEE---ETT-
T ss_pred CCCEEEEeCCCcCCCCCCCCCCCcEEEEEECCCCcEEEEEECChHHcccccccceEEEEccCCCCcceEEEEe---CCC-
Confidence 46788872 43 2211 23456999999999854432333211 2233 3333433 467776 221
Q ss_pred CCCCCceeEEEeCCCCc-eEeCCCCCCCCCCceEEEECCEEEE
Q 014195 185 CRGPTAHTFVLDTETKK-WQDLPPLPVPRYAPATQLWRGRLHV 226 (429)
Q Consensus 185 ~~~~~~~~~~yd~~t~~-W~~~~~~p~~r~~~~~~~~~~~lyv 226 (429)
...+.+||..+++ |+.......+.-.+.-..+++..+-
T Consensus 87 ----~~glIV~dl~~~~s~Rv~~~~~~~~p~~~~~~i~g~~~~ 125 (287)
T PF03022_consen 87 ----GPGLIVYDLATGKSWRVLHNSFSPDPDAGPFTIGGESFQ 125 (287)
T ss_dssp ----TCEEEEEETTTTEEEEEETCGCTTS-SSEEEEETTEEEE
T ss_pred ----cCcEEEEEccCCcEEEEecCCcceeccccceeccCceEe
Confidence 3488999999965 6665554344434444555555443
Done!