Query 001655
Match_columns 1036
No_of_seqs 201 out of 746
Neff 9.4
Searched_HMMs 46136
Date Fri Mar 29 06:09:05 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/001655.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/001655hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG1897 Damage-specific DNA bi 100.0 4E-178 8E-183 1488.8 111.3 1025 1-1036 51-1096(1096)
2 KOG1896 mRNA cleavage and poly 100.0 8E-134 2E-138 1148.1 96.3 1024 1-1035 69-1362(1366)
3 KOG1898 Splicing factor 3b, su 100.0 3E-126 7E-131 1072.7 78.6 1005 1-1033 53-1201(1205)
4 COG5161 SFT1 Pre-mRNA cleavage 100.0 2.3E-91 5E-96 768.8 68.8 1006 3-1029 54-1310(1319)
5 PF10433 MMS1_N: Mono-function 100.0 2.3E-62 5E-67 578.1 54.6 450 24-487 1-503 (504)
6 PF03178 CPSF_A: CPSF A subuni 100.0 1.1E-50 2.4E-55 451.7 36.8 310 691-1005 1-321 (321)
7 KOG0318 WD40 repeat stress pro 98.9 2.5E-05 5.5E-10 85.5 38.7 215 638-886 383-601 (603)
8 KOG2048 WD40 repeat protein [G 98.9 4.6E-05 1E-09 86.1 41.0 408 435-887 109-548 (691)
9 KOG1036 Mitotic spindle checkp 98.1 0.00055 1.2E-08 70.7 21.9 257 478-787 14-293 (323)
10 KOG0291 WD40-repeat-containing 98.0 0.054 1.2E-06 62.8 54.8 445 210-703 64-553 (893)
11 PRK11028 6-phosphogluconolacto 98.0 0.019 4.1E-07 64.4 34.9 185 660-867 125-328 (330)
12 KOG0319 WD40-repeat-containing 98.0 0.022 4.7E-07 65.9 33.9 359 437-843 63-442 (775)
13 PF10282 Lactonase: Lactonase, 97.9 0.041 9E-07 62.0 33.6 274 498-798 2-323 (345)
14 cd00200 WD40 WD40 domain, foun 97.8 0.043 9.3E-07 58.9 32.3 272 477-794 9-288 (289)
15 KOG0318 WD40 repeat stress pro 97.8 0.094 2E-06 58.5 42.8 350 398-796 237-599 (603)
16 KOG1446 Histone H3 (Lys4) meth 97.8 0.063 1.4E-06 56.2 30.7 144 630-796 150-302 (311)
17 PF03178 CPSF_A: CPSF A subuni 97.8 0.012 2.7E-07 65.6 27.9 193 672-886 42-264 (321)
18 KOG2106 Uncharacterized conser 97.8 0.099 2.1E-06 57.9 41.9 386 438-885 202-624 (626)
19 KOG0306 WD40-repeat-containing 97.8 0.15 3.2E-06 59.3 40.0 225 629-886 334-579 (888)
20 cd00200 WD40 WD40 domain, foun 97.6 0.09 1.9E-06 56.4 30.3 222 632-888 23-250 (289)
21 PF10282 Lactonase: Lactonase, 97.6 0.22 4.8E-06 56.2 38.4 296 543-865 1-344 (345)
22 KOG1539 WD repeat protein [Gen 97.6 0.33 7.2E-06 57.3 40.0 208 495-737 46-265 (910)
23 PRK11028 6-phosphogluconolacto 97.5 0.32 6.8E-06 54.5 35.2 270 454-797 10-304 (330)
24 KOG0647 mRNA export protein (c 97.4 0.049 1.1E-06 56.5 22.8 265 477-788 27-313 (347)
25 KOG2055 WD40 repeat protein [G 97.4 0.073 1.6E-06 58.4 24.6 199 530-757 216-417 (514)
26 PF02239 Cytochrom_D1: Cytochr 97.4 0.36 7.8E-06 54.6 32.0 314 414-760 15-350 (369)
27 KOG0319 WD40-repeat-containing 97.4 0.26 5.6E-06 57.4 29.7 352 476-888 61-443 (775)
28 KOG1408 WD40 repeat protein [F 97.3 0.025 5.4E-07 64.8 20.4 112 770-888 596-714 (1080)
29 KOG0291 WD40-repeat-containing 97.3 0.69 1.5E-05 54.2 55.1 316 478-843 266-612 (893)
30 KOG2106 Uncharacterized conser 97.2 0.62 1.4E-05 51.9 37.2 337 498-888 215-582 (626)
31 KOG1274 WD40 repeat protein [G 97.1 0.24 5.1E-06 59.1 26.4 74 661-757 189-262 (933)
32 KOG0310 Conserved WD40 repeat- 97.1 0.29 6.3E-06 54.3 25.1 272 477-795 26-306 (487)
33 KOG1273 WD40 repeat protein [G 96.8 0.19 4.1E-06 52.6 19.8 206 653-887 99-322 (405)
34 KOG2055 WD40 repeat protein [G 96.7 0.13 2.8E-06 56.5 19.0 127 422-560 244-375 (514)
35 COG2706 3-carboxymuconate cycl 96.6 1.4 3.1E-05 47.5 31.1 120 747-867 211-345 (346)
36 KOG0315 G-protein beta subunit 96.6 0.42 9E-06 48.6 19.9 221 636-884 58-285 (311)
37 KOG0296 Angio-associated migra 96.5 1.5 3.3E-05 47.1 28.1 312 438-795 66-396 (399)
38 PLN00181 protein SPA1-RELATED; 96.5 0.7 1.5E-05 58.6 26.9 200 662-886 577-792 (793)
39 TIGR02658 TTQ_MADH_Hv methylam 96.4 2.1 4.6E-05 47.6 30.2 263 415-711 27-342 (352)
40 TIGR03866 PQQ_ABC_repeats PQQ- 96.3 2.1 4.6E-05 46.6 32.8 258 503-797 8-279 (300)
41 KOG0647 mRNA export protein (c 96.3 0.62 1.3E-05 48.7 19.7 198 661-891 28-232 (347)
42 KOG0285 Pleiotropic regulator 96.3 1 2.3E-05 48.1 21.6 72 478-560 152-224 (460)
43 KOG1036 Mitotic spindle checkp 96.2 0.72 1.6E-05 48.4 20.0 249 661-958 14-271 (323)
44 PF08596 Lgl_C: Lethal giant l 96.2 0.4 8.7E-06 54.5 20.0 76 478-561 87-175 (395)
45 KOG1539 WD repeat protein [Gen 96.0 5.2 0.00011 47.8 48.8 394 408-849 175-610 (910)
46 KOG1407 WD40 repeat protein [F 95.6 3.2 6.9E-05 42.8 24.1 221 415-698 87-309 (313)
47 KOG2110 Uncharacterized conser 95.6 1.1 2.4E-05 48.3 18.7 154 398-561 89-250 (391)
48 KOG0263 Transcription initiati 95.4 0.92 2E-05 53.5 18.5 141 630-796 503-648 (707)
49 TIGR03866 PQQ_ABC_repeats PQQ- 95.3 5.3 0.00011 43.4 31.7 237 446-711 42-290 (300)
50 KOG2111 Uncharacterized conser 95.3 4.9 0.00011 42.7 24.9 257 663-951 8-324 (346)
51 KOG2048 WD40 repeat protein [G 95.3 8.2 0.00018 45.1 50.0 493 200-797 25-548 (691)
52 KOG0282 mRNA splicing factor [ 95.2 0.41 8.9E-06 53.1 14.4 251 638-945 236-501 (503)
53 KOG0283 WD40 repeat-containing 95.2 1.3 2.8E-05 52.6 19.3 111 438-560 371-482 (712)
54 PF00780 CNH: CNH domain; Int 95.2 5.9 0.00013 42.9 26.7 240 441-712 2-267 (275)
55 KOG2110 Uncharacterized conser 95.0 6.5 0.00014 42.7 24.6 228 692-948 68-329 (391)
56 KOG0276 Vesicle coat complex C 94.9 6.4 0.00014 45.5 22.8 74 477-560 13-86 (794)
57 KOG0310 Conserved WD40 repeat- 94.8 5.7 0.00012 44.5 21.6 191 663-885 113-307 (487)
58 KOG4378 Nuclear protein COP1 [ 94.7 1.3 2.8E-05 49.4 16.2 184 632-843 91-280 (673)
59 KOG0282 mRNA splicing factor [ 94.7 0.69 1.5E-05 51.4 14.3 220 631-884 271-502 (503)
60 KOG0306 WD40-repeat-containing 94.7 12 0.00027 44.3 25.8 118 761-885 497-620 (888)
61 KOG0278 Serine/threonine kinas 94.7 1 2.3E-05 45.8 14.3 118 651-796 175-296 (334)
62 PF00780 CNH: CNH domain; Int 94.7 7.7 0.00017 42.0 23.2 221 540-797 6-255 (275)
63 PF14727 PHTB1_N: PTHB1 N-term 94.6 11 0.00023 43.2 31.0 125 426-558 228-359 (418)
64 TIGR02658 TTQ_MADH_Hv methylam 94.6 9.4 0.0002 42.6 32.6 231 504-759 75-332 (352)
65 KOG0283 WD40 repeat-containing 94.4 2 4.3E-05 51.1 18.2 156 660-844 409-577 (712)
66 KOG0294 WD40 repeat-containing 94.4 8.1 0.00018 41.0 23.9 254 478-777 44-304 (362)
67 KOG1273 WD40 repeat protein [G 94.3 8.4 0.00018 40.9 20.6 185 480-682 26-218 (405)
68 KOG0316 Conserved WD40 repeat- 94.3 3.9 8.4E-05 41.5 17.2 109 659-793 182-295 (307)
69 TIGR03300 assembly_YfgL outer 94.2 13 0.00028 42.4 29.9 135 406-557 241-377 (377)
70 PLN00181 protein SPA1-RELATED; 93.8 26 0.00056 44.5 34.2 218 638-887 504-738 (793)
71 KOG0275 Conserved WD40 repeat- 93.7 0.53 1.2E-05 49.2 10.3 270 654-982 205-493 (508)
72 PF14727 PHTB1_N: PTHB1 N-term 93.5 17 0.00038 41.5 33.3 140 638-795 154-316 (418)
73 KOG4378 Nuclear protein COP1 [ 93.5 14 0.00031 41.6 21.1 60 495-559 91-151 (673)
74 KOG0299 U3 snoRNP-associated p 93.4 8.3 0.00018 43.0 19.2 133 637-796 306-453 (479)
75 KOG2321 WD40 repeat protein [G 93.3 1.6 3.4E-05 49.7 14.0 138 448-600 148-296 (703)
76 KOG0649 WD40 repeat protein [G 93.3 2 4.4E-05 43.6 13.3 145 728-887 21-186 (325)
77 KOG0289 mRNA splicing factor [ 93.2 16 0.00036 40.5 22.8 193 658-884 301-503 (506)
78 PTZ00420 coronin; Provisional 93.2 24 0.00052 42.2 26.5 214 661-913 75-311 (568)
79 KOG0278 Serine/threonine kinas 93.0 3.4 7.4E-05 42.2 14.5 142 406-561 155-299 (334)
80 KOG2445 Nuclear pore complex c 93.0 3.3 7.1E-05 43.7 14.8 134 651-797 101-256 (361)
81 PRK11138 outer membrane biogen 92.9 21 0.00046 40.9 28.8 127 414-557 265-392 (394)
82 KOG1645 RING-finger-containing 92.8 7 0.00015 42.9 17.3 64 497-564 208-271 (463)
83 KOG0316 Conserved WD40 repeat- 92.8 13 0.00028 38.0 20.5 154 385-561 102-259 (307)
84 KOG0289 mRNA splicing factor [ 92.7 19 0.00042 39.9 24.2 144 628-797 313-460 (506)
85 KOG0646 WD40 repeat protein [G 92.3 9 0.0002 42.8 17.7 204 655-888 76-308 (476)
86 KOG0645 WD40 repeat protein [G 92.1 17 0.00037 37.9 27.0 256 638-945 36-307 (312)
87 KOG0277 Peroxisomal targeting 91.6 17 0.00038 37.5 17.5 66 729-797 21-91 (311)
88 KOG0650 WD40 repeat nucleolar 91.4 18 0.00039 41.9 19.1 184 637-843 420-637 (733)
89 KOG2321 WD40 repeat protein [G 91.3 12 0.00027 42.9 17.7 207 540-779 62-280 (703)
90 KOG0772 Uncharacterized conser 91.3 18 0.00039 41.0 18.7 240 663-951 217-489 (641)
91 PF02239 Cytochrom_D1: Cytochr 91.3 31 0.00066 39.2 22.5 200 495-712 5-214 (369)
92 KOG0640 mRNA cleavage stimulat 91.2 7.7 0.00017 40.9 14.9 211 454-681 192-417 (430)
93 KOG1897 Damage-specific DNA bi 91.1 47 0.001 41.1 56.9 464 260-845 452-944 (1096)
94 KOG0646 WD40 repeat protein [G 90.7 21 0.00046 40.0 18.5 203 729-958 93-316 (476)
95 KOG0315 G-protein beta subunit 90.2 25 0.00053 36.3 24.6 96 455-561 60-156 (311)
96 TIGR03300 assembly_YfgL outer 90.2 38 0.00083 38.5 31.4 100 444-559 63-163 (377)
97 COG2706 3-carboxymuconate cycl 89.7 35 0.00075 37.3 32.8 232 455-705 63-328 (346)
98 KOG4649 PQQ (pyrrolo-quinoline 89.7 27 0.00058 36.3 16.9 106 666-797 16-121 (354)
99 KOG0294 WD40 repeat-containing 89.6 32 0.00069 36.8 26.9 195 692-916 107-305 (362)
100 PRK11138 outer membrane biogen 88.8 50 0.0011 37.9 29.5 104 444-559 67-178 (394)
101 PF04053 Coatomer_WDAD: Coatom 88.7 25 0.00055 40.8 18.5 165 585-792 41-218 (443)
102 KOG1274 WD40 repeat protein [G 88.6 69 0.0015 39.3 22.2 198 436-648 56-263 (933)
103 KOG0266 WD40 repeat-containing 88.5 58 0.0012 38.2 24.6 180 748-951 224-411 (456)
104 KOG0650 WD40 repeat nucleolar 88.5 28 0.0006 40.4 17.6 181 362-556 533-732 (733)
105 KOG0276 Vesicle coat complex C 88.4 58 0.0013 38.2 34.3 174 414-610 76-253 (794)
106 KOG1538 Uncharacterized conser 87.9 63 0.0014 38.0 21.0 40 632-681 245-284 (1081)
107 PTZ00421 coronin; Provisional 87.5 68 0.0015 38.0 29.6 77 477-560 75-157 (493)
108 KOG0266 WD40 repeat-containing 87.5 66 0.0014 37.8 25.8 243 477-758 159-410 (456)
109 KOG1034 Transcriptional repres 87.3 18 0.00038 38.8 14.3 123 704-843 79-211 (385)
110 PF13360 PQQ_2: PQQ-like domai 86.4 45 0.00097 34.8 24.1 172 692-885 3-189 (238)
111 KOG2096 WD40 repeat protein [G 86.2 36 0.00079 36.4 15.8 149 632-803 100-264 (420)
112 KOG2111 Uncharacterized conser 86.0 54 0.0012 35.2 26.0 121 435-562 180-325 (346)
113 KOG3881 Uncharacterized conser 85.4 7.3 0.00016 42.6 10.7 90 692-796 226-319 (412)
114 KOG4441 Proteins containing BT 84.5 25 0.00054 42.4 16.2 189 666-876 328-530 (571)
115 KOG0772 Uncharacterized conser 84.4 83 0.0018 36.1 20.6 180 544-737 284-477 (641)
116 KOG0288 WD40 repeat protein Ti 84.4 9.1 0.0002 42.1 10.9 104 653-777 334-438 (459)
117 KOG0305 Anaphase promoting com 84.1 91 0.002 36.3 25.8 253 446-737 188-451 (484)
118 KOG0649 WD40 repeat protein [G 83.9 56 0.0012 33.7 18.8 205 70-333 17-237 (325)
119 KOG1587 Cytoplasmic dynein int 83.5 1.1E+02 0.0023 36.6 20.3 80 475-560 240-324 (555)
120 KOG1517 Guanine nucleotide bin 83.5 1.3E+02 0.0029 37.8 23.7 142 632-797 1178-1333(1387)
121 PTZ00421 coronin; Provisional 83.4 1E+02 0.0023 36.4 27.7 113 438-559 77-198 (493)
122 KOG0284 Polyadenylation factor 83.2 23 0.00051 39.0 13.3 253 540-839 107-376 (464)
123 PF06433 Me-amine-dh_H: Methyl 82.9 81 0.0018 34.8 24.0 116 632-761 197-324 (342)
124 KOG0268 Sof1-like rRNA process 82.3 35 0.00077 37.1 14.0 70 478-559 273-345 (433)
125 KOG2114 Vacuolar assembly/sort 82.2 1.2E+02 0.0026 37.2 19.6 211 438-662 27-256 (933)
126 KOG1517 Guanine nucleotide bin 82.2 1.5E+02 0.0033 37.4 22.3 223 662-915 1066-1311(1387)
127 KOG0299 U3 snoRNP-associated p 82.1 95 0.0021 35.1 23.7 240 478-760 203-462 (479)
128 KOG1188 WD40 repeat protein [G 82.0 59 0.0013 35.3 15.4 141 410-561 45-198 (376)
129 PF12894 Apc4_WD40: Anaphase-p 82.0 3.8 8.3E-05 30.7 5.0 38 470-514 4-41 (47)
130 PF14761 HPS3_N: Hermansky-Pud 81.9 65 0.0014 33.0 17.3 165 636-835 35-207 (215)
131 PHA02713 hypothetical protein; 81.3 39 0.00084 40.8 16.3 150 729-888 352-532 (557)
132 KOG1896 mRNA cleavage and poly 81.3 1.7E+02 0.0037 37.5 25.0 94 750-846 1117-1216(1366)
133 KOG4441 Proteins containing BT 81.2 33 0.0007 41.5 15.4 174 690-879 299-486 (571)
134 KOG0272 U4/U6 small nuclear ri 81.2 98 0.0021 34.6 17.8 73 628-709 353-427 (459)
135 PF08553 VID27: VID27 cytoplas 80.2 1.6E+02 0.0035 36.7 20.6 96 407-512 494-604 (794)
136 PF11768 DUF3312: Protein of u 79.8 1.3E+02 0.0029 35.2 30.6 186 662-863 147-349 (545)
137 KOG3881 Uncharacterized conser 79.7 23 0.00049 38.9 11.7 131 769-911 104-249 (412)
138 PF14783 BBS2_Mid: Ciliary BBS 79.6 48 0.001 30.0 12.0 66 716-795 2-69 (111)
139 PF14779 BBS1: Ciliary BBSome 79.6 14 0.00031 38.8 10.1 77 477-556 176-255 (257)
140 KOG0271 Notchless-like WD40 re 79.2 1.1E+02 0.0023 33.9 27.2 309 435-789 114-471 (480)
141 KOG1408 WD40 repeat protein [F 78.7 65 0.0014 38.3 15.6 97 634-757 613-713 (1080)
142 KOG2919 Guanine nucleotide-bin 78.7 75 0.0016 34.2 14.8 222 636-888 68-328 (406)
143 PF12234 Rav1p_C: RAVE protein 78.5 39 0.00084 40.7 14.4 119 655-795 23-154 (631)
144 KOG0288 WD40 repeat protein Ti 78.1 31 0.00067 38.2 12.2 98 414-520 321-423 (459)
145 PHA02713 hypothetical protein; 78.1 77 0.0017 38.2 17.4 138 729-875 304-470 (557)
146 KOG0279 G protein beta subunit 77.8 99 0.0022 32.7 26.6 134 415-559 172-313 (315)
147 PHA03098 kelch-like protein; P 77.7 60 0.0013 39.0 16.5 132 729-870 343-489 (534)
148 KOG0302 Ribosome Assembly prot 77.1 82 0.0018 34.7 14.8 136 639-797 234-378 (440)
149 KOG0273 Beta-transducin family 77.0 1.4E+02 0.003 33.9 26.9 244 477-777 235-500 (524)
150 KOG0279 G protein beta subunit 76.6 1.1E+02 0.0023 32.5 24.9 154 663-842 151-312 (315)
151 KOG0290 Conserved WD40 repeat- 76.0 67 0.0015 34.1 13.4 155 721-887 51-227 (364)
152 KOG0296 Angio-associated migra 76.0 1.3E+02 0.0028 33.1 21.5 73 477-558 283-355 (399)
153 PF08662 eIF2A: Eukaryotic tra 74.4 1E+02 0.0022 31.2 15.1 94 653-771 50-145 (194)
154 PF08450 SGL: SMP-30/Gluconola 74.2 1.2E+02 0.0026 31.9 26.7 210 632-867 13-233 (246)
155 KOG0313 Microtubule binding pr 74.2 1.5E+02 0.0032 32.9 22.5 68 495-565 115-183 (423)
156 KOG0308 Conserved WD40 repeat- 74.2 49 0.0011 38.9 13.0 177 692-887 95-285 (735)
157 KOG0305 Anaphase promoting com 73.8 1.9E+02 0.004 33.9 22.3 196 660-888 217-462 (484)
158 KOG0271 Notchless-like WD40 re 73.6 83 0.0018 34.7 13.8 154 769-950 114-277 (480)
159 KOG0640 mRNA cleavage stimulat 72.8 13 0.00028 39.4 7.4 114 661-796 217-334 (430)
160 KOG2096 WD40 repeat protein [G 71.8 1.5E+02 0.0033 32.0 21.4 261 437-729 87-386 (420)
161 KOG4328 WD40 protein [Function 70.9 1.9E+02 0.0042 32.8 21.3 97 638-756 390-494 (498)
162 PF08596 Lgl_C: Lethal giant l 70.4 2E+02 0.0044 32.9 18.8 106 671-796 96-242 (395)
163 KOG2394 WD40 protein DMR-N9 [G 70.2 2.2E+02 0.0047 33.1 18.0 89 770-867 290-383 (636)
164 PF11768 DUF3312: Protein of u 69.6 2.3E+02 0.0051 33.3 26.4 109 406-533 237-347 (545)
165 KOG0643 Translation initiation 69.3 1.6E+02 0.0034 31.1 15.8 135 414-558 73-219 (327)
166 KOG1407 WD40 repeat protein [F 69.1 1.5E+02 0.0034 31.0 13.9 144 662-840 66-216 (313)
167 KOG0321 WD40 repeat-containing 68.0 60 0.0013 38.1 12.0 203 728-950 63-302 (720)
168 KOG0643 Translation initiation 67.7 1.7E+02 0.0036 30.9 25.8 261 663-980 13-296 (327)
169 KOG1645 RING-finger-containing 67.7 26 0.00057 38.6 8.7 110 662-796 195-314 (463)
170 KOG0273 Beta-transducin family 67.5 2.3E+02 0.0049 32.3 23.9 274 476-795 177-480 (524)
171 KOG1188 WD40 repeat protein [G 67.0 2E+02 0.0043 31.5 15.3 186 634-844 45-243 (376)
172 PF10433 MMS1_N: Mono-function 67.0 2.7E+02 0.0059 33.1 44.7 324 447-797 1-388 (504)
173 KOG0771 Prolactin regulatory e 65.7 57 0.0012 36.3 10.8 75 709-797 277-354 (398)
174 PF07433 DUF1513: Protein of u 64.8 1.1E+02 0.0024 33.3 12.7 116 657-789 1-119 (305)
175 cd00216 PQQ_DH Dehydrogenases 64.8 3E+02 0.0064 32.7 21.4 62 690-761 254-323 (488)
176 KOG0263 Transcription initiati 63.9 2.4E+02 0.0051 34.2 16.1 110 398-515 529-650 (707)
177 COG5276 Uncharacterized conser 60.2 2.4E+02 0.0052 30.4 13.6 121 763-888 79-200 (370)
178 KOG1538 Uncharacterized conser 59.7 1.3E+02 0.0027 35.7 12.5 114 438-558 134-251 (1081)
179 KOG0295 WD40 repeat-containing 59.6 2.8E+02 0.006 30.6 20.5 253 450-736 124-395 (406)
180 KOG0293 WD40 repeat-containing 59.5 3E+02 0.0064 30.9 18.8 194 660-888 269-471 (519)
181 PF00325 Crp: Bacterial regula 59.4 13 0.00028 25.3 2.9 25 1010-1034 4-28 (32)
182 PF13360 PQQ_2: PQQ-like domai 58.4 2.3E+02 0.005 29.3 24.0 172 692-888 46-231 (238)
183 KOG4547 WD40 repeat-containing 58.3 3.1E+02 0.0066 32.2 15.3 107 728-851 69-178 (541)
184 PF14781 BBS2_N: Ciliary BBSom 57.7 79 0.0017 29.7 8.7 54 711-777 45-99 (136)
185 PF04762 IKI3: IKI3 family; I 57.4 5.4E+02 0.012 33.3 50.0 89 427-525 62-160 (928)
186 KOG0771 Prolactin regulatory e 57.1 63 0.0014 35.9 9.4 36 478-520 282-317 (398)
187 KOG0270 WD40 repeat-containing 56.8 1.8E+02 0.0039 32.9 12.6 93 455-559 265-360 (463)
188 KOG2066 Vacuolar assembly/sort 56.3 2E+02 0.0044 35.1 13.8 170 478-678 40-222 (846)
189 KOG1240 Protein kinase contain 56.0 4.7E+02 0.01 33.9 17.2 123 430-560 1093-1226(1431)
190 PTZ00420 coronin; Provisional 55.9 4.4E+02 0.0095 31.8 30.8 75 437-520 126-203 (568)
191 KOG0269 WD40 repeat-containing 54.9 45 0.00097 40.0 8.2 114 661-797 134-250 (839)
192 KOG1332 Vesicle coat complex C 54.8 2E+02 0.0043 30.0 11.7 110 446-561 23-136 (299)
193 KOG3621 WD40 repeat-containing 53.6 99 0.0021 37.0 10.7 145 692-856 55-208 (726)
194 KOG4328 WD40 protein [Function 53.5 3.9E+02 0.0085 30.5 20.4 77 476-559 185-265 (498)
195 PF08553 VID27: VID27 cytoplas 51.7 50 0.0011 40.9 8.5 88 212-307 541-629 (794)
196 KOG3914 WD repeat protein WDR4 51.0 2.6E+02 0.0056 31.2 12.7 146 726-888 71-224 (390)
197 KOG4227 WD40 repeat protein [G 51.0 3.8E+02 0.0083 29.7 15.2 30 860-889 295-324 (609)
198 KOG0642 Cell-cycle nuclear pro 50.6 3.7E+02 0.008 31.5 14.2 234 259-515 306-562 (577)
199 KOG1587 Cytoplasmic dynein int 50.3 1.8E+02 0.0039 34.8 12.5 153 718-888 349-517 (555)
200 PF14779 BBS1: Ciliary BBSome 50.1 47 0.001 35.1 6.8 201 717-947 18-256 (257)
201 PHA03098 kelch-like protein; P 50.1 1.6E+02 0.0035 35.4 12.7 132 729-869 295-438 (534)
202 KOG0277 Peroxisomal targeting 48.9 3.4E+02 0.0075 28.5 19.8 77 269-355 36-112 (311)
203 PF00400 WD40: WD domain, G-be 48.3 35 0.00077 23.6 4.1 30 476-512 10-39 (39)
204 KOG3617 WD40 and TPR repeat-co 47.6 49 0.0011 40.1 7.1 119 707-844 8-132 (1416)
205 KOG0274 Cdc4 and related F-box 46.4 5.9E+02 0.013 30.5 20.5 180 363-560 219-401 (537)
206 PF15390 DUF4613: Domain of un 45.9 1.6E+02 0.0034 34.8 10.5 70 729-811 124-195 (671)
207 PF02978 SRP_SPB: Signal pepti 45.7 31 0.00067 31.0 4.2 29 1007-1035 72-100 (104)
208 PF08728 CRT10: CRT10; InterP 44.2 69 0.0015 39.1 7.9 63 825-887 177-246 (717)
209 KOG0269 WD40 repeat-containing 43.9 5.6E+02 0.012 31.4 14.7 166 494-673 99-276 (839)
210 PF15390 DUF4613: Domain of un 43.5 3E+02 0.0064 32.7 12.2 74 653-738 329-406 (671)
211 PF14783 BBS2_Mid: Ciliary BBS 43.5 2.6E+02 0.0056 25.5 13.5 91 447-553 16-108 (111)
212 KOG2919 Guanine nucleotide-bin 43.3 4E+02 0.0086 29.0 12.2 111 722-844 213-328 (406)
213 PF14655 RAB3GAP2_N: Rab3 GTPa 41.7 2.5E+02 0.0055 32.2 11.6 41 707-757 50-97 (415)
214 COG1654 BirA Biotin operon rep 39.9 34 0.00073 28.9 3.2 27 1008-1034 19-45 (79)
215 PHA02790 Kelch-like protein; P 39.9 4E+02 0.0086 31.5 13.6 136 729-874 272-413 (480)
216 PF06977 SdiA-regulated: SdiA- 39.5 4.9E+02 0.011 27.6 21.0 191 475-678 19-239 (248)
217 KOG1446 Histone H3 (Lys4) meth 39.1 5.3E+02 0.012 27.9 28.3 256 434-719 12-281 (311)
218 PHA02790 Kelch-like protein; P 38.1 6.9E+02 0.015 29.5 15.2 128 729-874 319-452 (480)
219 KOG4283 Transcription-coupled 37.9 5.4E+02 0.012 27.6 15.7 136 746-886 208-364 (397)
220 KOG0272 U4/U6 small nuclear ri 37.5 6.6E+02 0.014 28.5 20.3 134 632-797 233-375 (459)
221 KOG0281 Beta-TrCP (transducin 37.2 6E+02 0.013 27.9 13.0 251 496-796 208-476 (499)
222 KOG3679 Predicted coiled-coil 34.6 1.5E+02 0.0034 32.1 7.8 73 572-645 195-271 (802)
223 PF12234 Rav1p_C: RAVE protein 34.0 4.8E+02 0.01 31.7 12.7 107 445-557 40-155 (631)
224 KOG3621 WD40 repeat-containing 33.8 91 0.002 37.3 6.5 104 728-844 44-155 (726)
225 KOG0280 Uncharacterized conser 33.6 6.4E+02 0.014 27.2 19.2 156 729-887 24-196 (339)
226 KOG0280 Uncharacterized conser 33.5 6.3E+02 0.014 27.2 11.8 99 450-559 89-196 (339)
227 KOG0308 Conserved WD40 repeat- 33.0 9.3E+02 0.02 29.0 14.0 155 768-949 115-284 (735)
228 KOG0275 Conserved WD40 repeat- 33.0 6.6E+02 0.014 27.2 15.6 73 480-561 216-295 (508)
229 TIGR02276 beta_rpt_yvtn 40-res 32.8 1.6E+02 0.0035 20.6 5.7 29 639-669 14-42 (42)
230 PF08279 HTH_11: HTH domain; 32.8 53 0.0012 25.2 3.2 26 1009-1034 16-41 (55)
231 PF06977 SdiA-regulated: SdiA- 32.3 1.3E+02 0.0029 31.8 7.0 61 212-276 182-247 (248)
232 KOG0286 G-protein beta subunit 31.4 6.9E+02 0.015 26.9 26.1 265 212-512 66-343 (343)
233 KOG0270 WD40 repeat-containing 30.0 8.8E+02 0.019 27.7 15.6 128 436-574 286-419 (463)
234 PF04053 Coatomer_WDAD: Coatom 29.6 9.5E+02 0.021 28.0 16.6 139 64-233 33-175 (443)
235 KOG2394 WD40 protein DMR-N9 [G 29.4 9.9E+02 0.021 28.1 13.2 75 662-761 292-366 (636)
236 PF13412 HTH_24: Winged helix- 28.8 58 0.0013 24.2 2.7 38 997-1034 6-43 (48)
237 KOG1445 Tumor-specific antigen 28.8 5.3E+02 0.012 30.7 11.2 67 446-518 640-712 (1012)
238 KOG0268 Sof1-like rRNA process 28.6 8.5E+02 0.018 27.1 15.2 162 505-680 166-334 (433)
239 PF13404 HTH_AsnC-type: AsnC-t 28.3 51 0.0011 24.0 2.2 39 995-1033 4-42 (42)
240 KOG0301 Phospholipase A2-activ 28.2 5.3E+02 0.011 31.1 11.2 112 769-890 178-291 (745)
241 KOG4497 Uncharacterized conser 28.2 1.7E+02 0.0036 31.8 6.7 114 116-230 248-390 (447)
242 KOG0321 WD40 repeat-containing 27.9 1.9E+02 0.0041 34.2 7.6 123 430-560 48-176 (720)
243 KOG2395 Protein involved in va 27.9 2.5E+02 0.0054 32.7 8.3 89 414-512 355-457 (644)
244 KOG0293 WD40 repeat-containing 27.8 9.3E+02 0.02 27.3 21.7 197 347-559 224-425 (519)
245 PF08662 eIF2A: Eukaryotic tra 27.8 6.4E+02 0.014 25.4 14.1 130 729-871 17-156 (194)
246 KOG0295 WD40 repeat-containing 27.8 8.8E+02 0.019 27.0 15.1 72 438-518 293-368 (406)
247 TIGR02276 beta_rpt_yvtn 40-res 27.7 2.2E+02 0.0047 19.9 5.8 38 495-534 3-40 (42)
248 KOG0301 Phospholipase A2-activ 27.1 1.2E+03 0.026 28.3 19.2 183 768-964 99-305 (745)
249 PF13543 KSR1-SAM: SAM like do 27.0 1.1E+02 0.0024 28.6 4.6 39 997-1035 90-128 (129)
250 PF15525 DUF4652: Domain of un 26.3 5.7E+02 0.012 25.6 9.5 92 685-783 81-175 (200)
251 PF08728 CRT10: CRT10; InterP 26.1 4E+02 0.0087 32.8 10.3 149 21-172 112-282 (717)
252 PLN02153 epithiospecifier prot 25.8 9.4E+02 0.02 26.6 15.8 137 729-873 86-256 (341)
253 KOG1063 RNA polymerase II elon 25.6 1.3E+03 0.028 28.1 16.6 188 588-798 24-225 (764)
254 PF07569 Hira: TUP1-like enhan 25.5 2.1E+02 0.0046 29.7 7.1 77 474-559 9-95 (219)
255 KOG0274 Cdc4 and related F-box 25.3 1.2E+03 0.027 27.9 22.3 234 662-957 251-490 (537)
256 KOG1063 RNA polymerase II elon 25.1 1.1E+03 0.024 28.6 13.0 65 495-560 630-700 (764)
257 PRK12784 hypothetical protein; 24.9 3.3E+02 0.0071 22.8 6.2 52 215-267 33-84 (84)
258 COG5161 SFT1 Pre-mRNA cleavage 24.6 19 0.00042 43.4 -0.8 80 3-91 94-176 (1319)
259 PF05096 Glu_cyclase_2: Glutam 24.1 9E+02 0.02 25.8 18.7 89 690-795 66-155 (264)
260 PF13545 HTH_Crp_2: Crp-like h 23.8 82 0.0018 26.0 3.1 25 1010-1034 30-54 (76)
261 PF06971 Put_DNA-bind_N: Putat 23.2 78 0.0017 24.1 2.4 19 1012-1030 32-50 (50)
262 PF14870 PSII_BNR: Photosynthe 23.2 1E+03 0.022 26.1 15.8 200 650-885 6-213 (302)
263 smart00550 Zalpha Z-DNA-bindin 23.0 1.1E+02 0.0023 25.1 3.4 38 998-1035 10-49 (68)
264 KOG1332 Vesicle coat complex C 22.7 5.3E+02 0.011 27.0 8.8 114 821-951 19-136 (299)
265 PF08220 HTH_DeoR: DeoR-like h 22.4 81 0.0018 24.7 2.5 29 1006-1034 12-40 (57)
266 PF05920 Homeobox_KN: Homeobox 22.1 1.4E+02 0.0031 21.5 3.5 28 1007-1034 12-39 (40)
267 PF12341 DUF3639: Protein of u 22.1 2.4E+02 0.0052 18.5 4.1 24 436-459 1-24 (27)
268 PF08280 HTH_Mga: M protein tr 22.0 66 0.0014 25.4 2.0 36 999-1034 10-45 (59)
269 smart00419 HTH_CRP helix_turn_ 21.8 1.1E+02 0.0024 22.3 3.1 26 1009-1034 9-34 (48)
270 KOG0286 G-protein beta subunit 21.2 1.1E+03 0.023 25.6 28.0 271 478-789 56-334 (343)
271 PF09826 Beta_propel: Beta pro 21.1 1.4E+03 0.031 27.2 33.4 107 669-790 279-389 (521)
272 KOG0284 Polyadenylation factor 21.1 3.2E+02 0.007 30.6 7.4 72 439-518 267-341 (464)
273 PF02023 SCAN: SCAN domain; I 21.0 1.6E+02 0.0036 25.9 4.4 45 992-1036 43-88 (95)
274 PF11972 HTH_13: HTH DNA bindi 20.9 1.6E+02 0.0035 22.9 3.6 35 998-1032 3-37 (54)
275 KOG1898 Splicing factor 3b, su 20.8 1.9E+03 0.041 28.4 36.4 102 212-320 548-659 (1205)
276 PF08309 LVIVD: LVIVD repeat; 20.8 2.4E+02 0.0052 20.6 4.4 25 818-842 4-28 (42)
277 KOG1272 WD40-repeat-containing 20.7 4.7E+02 0.01 30.0 8.6 173 636-842 146-322 (545)
278 PF04762 IKI3: IKI3 family; I 20.3 1.9E+03 0.042 28.3 52.5 74 478-560 305-380 (928)
279 PF15492 Nbas_N: Neuroblastoma 20.2 1.1E+03 0.024 25.4 17.6 132 632-785 11-163 (282)
280 PF09288 UBA_3: Fungal ubiquit 20.1 1.7E+02 0.0036 22.8 3.6 39 995-1033 8-54 (55)
No 1
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=100.00 E-value=3.8e-178 Score=1488.77 Aligned_cols=1025 Identities=63% Similarity=1.036 Sum_probs=973.5
Q ss_pred CeeEEEeEEEeEeeeeccCCCCccEEEEEeCcCcEEEEEEeCCCCcEEEEEeeeccCCCCccCCCCCeEEECCCCCEEEE
Q 001655 1 MLDVPIYGRIATLELFRPHGEAQDFLFIATERYKFCVLQWDAESSELITRAMGDVSDRIGRPTDNGQIGIIDPDCRLIGL 80 (1036)
Q Consensus 1 ~~~~~l~g~i~~i~~~r~~~~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s~~~~~~~~~~~~~~~~~l~vdp~~r~~~~ 80 (1036)
++++++||+|..|+.|||+++++|+|+|+|+++++++|+||....+.+|...+...++.+|+.++|++++|||.+|.+++
T Consensus 51 i~sv~ifg~I~~i~~fRp~g~~kD~LfV~t~~~~~~iL~~d~~~~~vv~~a~~~v~dr~gr~s~~g~~~~VDp~~R~Igl 130 (1096)
T KOG1897|consen 51 ITSVPIFGTIATIALFRPPGSDKDYLFVATDSYRYFILEWDEESIQVVTRAHGDVSDRSGRPSDNGQILLVDPKGRVIGL 130 (1096)
T ss_pred eEeeccceeEEEEEeecCCCCCcceEEEEECcceEEEEEEccccceEEEEecccccccccccCCCceEEEECCCCcEEEE
Confidence 57899999999999999999999999999999999999999877889999999999988999999999999999999999
Q ss_pred EecCCeEEEEeCCCC-----CccccceecccCCceEEEEEeecCCCCCEEEEEEEecCCcceEEEEEEeccCCceeeccc
Q 001655 81 HLYDGLFKVIPFDNK-----GQLKEAFNIRLEELQVLDIKFLYGCAKPTIVVLYQDNKDARHVKTYEVALKDKDFVEGPW 155 (1036)
Q Consensus 81 ~~~~~~~~ilp~~~~-----~~~~~~~~~~l~~~~i~d~~FL~~~~~ptlavL~~~~~~~~~l~~~~~~~~~~~~~~~~~ 155 (1036)
++|+|+++|+|+.+. ..+...|++|+++.+|.||+||++...||+|+||.|. ..+|+++|+++++++++.++.|
T Consensus 131 ~~yqgl~~vIp~d~~~sht~~s~l~~fn~rfdel~v~Di~fly~~s~pt~~vly~Ds-~~~Hv~~yelnl~~ke~~~~~w 209 (1096)
T KOG1897|consen 131 HLYQGLFKVIPIDSDESHTGGSLLKAFNVRFDELNVYDIKFLYGCSDPTLAVLYKDS-DGRHVKTYELNLRDKEFVKGPW 209 (1096)
T ss_pred EeecCeEEEEEecccccccCcccccccccccCcceEEEEEEEcCCCCCceEEEEEcC-CCcEEEEEEeccchhhcccccc
Confidence 999999999999886 5566789999999999999999999999999999998 8899999999999999999999
Q ss_pred cccccCCCCCEEEecCCCCcceEEEeCceEEEEcCCceeeec---cCcceeeEEEEEecCCCEEEEEcCccCEEEEEEEe
Q 001655 156 SQNNLDNGADLLIPVPPPLCGVLIIGEETIVYCSANAFKAIP---IRPSITKAYGRVDADGSRYLLGDHAGLLHLLVITH 232 (1036)
Q Consensus 156 ~~~~lp~~~~~lip~p~~~~G~lv~~~~~i~y~~~~~~~~~~---~~~~~~~~~~~~~~~~~~~ll~~~~G~l~~l~l~~ 232 (1036)
+ +++..++..+||+|.|.||+||+|++.|+|+++..+.+++ .+++.+.||++++.++.+||++|++|+||++.+..
T Consensus 210 ~-~~v~~~a~~li~VP~~~gGvlV~ge~~I~Y~~~~~~~ai~p~~~~~~t~~~~~~v~~~~~~yLl~d~~G~Lf~l~l~~ 288 (1096)
T KOG1897|consen 210 S-NNVDNGASMLIPVPSPIGGVLVIGEEFIVYMSGDNFVAIAPLTAEQSTIVCYGRVDLQGSRYLLGDEDGMLFKLLLSH 288 (1096)
T ss_pred c-cccccCCceeeecCCCCceEEEEeeeEEEEeeCCceeEecccccCCceEEEcccccCCccEEEEecCCCcEEEEEeec
Confidence 9 9999999999999999999999999999999998877765 67788999999999999999999999999999998
Q ss_pred cCcEEee--EEEEEcCccccceEEEEecCCeEEEEEeecCeeEEEEeeCCCCCCCcEEEeeecccCCceeeeEEeccCCC
Q 001655 233 EKEKVTG--LKIELLGETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQPDAKGSYVEVLERYVNLGPIVDFCVVDLERQ 310 (1036)
Q Consensus 233 ~~~~v~~--l~i~~~~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~~l~n~~Pi~D~~~~~~~~~ 310 (1036)
.+.++.+ |+++++|++++|+||++|++|+||+||++|||+|+++..++|. ++|..++++++|+|||.||++.+.+++
T Consensus 289 ~~e~~s~~~lkve~lge~siassi~~L~ng~lFvGS~~gdSqLi~L~~e~d~-gsy~~ilet~~NLgPI~Dm~Vvd~d~q 367 (1096)
T KOG1897|consen 289 TGETVSGLDLKVEYLGETSIASSINYLDNGVLFVGSRFGDSQLIKLNTEPDV-GSYVVILETFVNLGPIVDMCVVDLDRQ 367 (1096)
T ss_pred ccccccceEEEEEecCCcchhhhhhcccCceEEEeccCCceeeEEccccCCC-CchhhhhhhcccccceeeEEEEecccc
Confidence 8888887 8999999999999999999999999999999999999998876 888999999999999999999999889
Q ss_pred CCceEEEEeeCCCCccEEEEecCCceeEEEeeeCCCcceEEEeecCCCCCcccEEEEEecCceEEEEecCCCCeeeeeec
Q 001655 311 GQGQVVTCSGAYKDGSLRIVRNGIGINEQASVELQGIKGMWSLRSSTDDPFDTFLVVSFISETRILAMNLEDELEETEIE 390 (1036)
Q Consensus 311 ~~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~~~l~~~~~iw~l~~~~~~~~~~~lv~S~~~~T~vl~~~~~~~~~e~~~~ 390 (1036)
+++++++|||++++|+||++|+|+++++.+..++||++++|+++....++++.||++||.++|++|.+++ ++||++++
T Consensus 368 ~q~qivtCsGa~kdgSLRiiRngi~I~e~A~i~l~Gikg~w~lk~~v~~~~d~ylvlsf~~eTrvl~i~~--e~ee~~~~ 445 (1096)
T KOG1897|consen 368 GQGQIVTCSGAFKDGSLRIIRNGIGIDELASIDLPGIKGMWSLKSMVDENYDNYLVLSFISETRVLNISE--EVEETEDP 445 (1096)
T ss_pred CCceEEEEeCCCCCCcEEEEecccccceeeEeecCCccceeEeeccccccCCcEEEEEeccceEEEEEcc--ceEEeccc
Confidence 9999999999999999999999999999999999999999999976667888999999999999999986 49999999
Q ss_pred CeeccccceeeeecCCCeEEEEecCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEE
Q 001655 391 GFCSQTQTLFCHDAIYNQLVQVTSGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGDGILTE 470 (1036)
Q Consensus 391 ~f~~~~~Tl~~~~~~~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~ 470 (1036)
||.++++||+|+.+.++.++|||+++||+++.+ .+.++|.+|.+..|..+++|..+++||.+++.+.|++++.+.+.+
T Consensus 446 gf~~~~~Tif~S~i~g~~lvQvTs~~iRl~ss~--~~~~~W~~p~~~ti~~~~~n~sqVvvA~~~~~l~y~~i~~~~l~e 523 (1096)
T KOG1897|consen 446 GFSTDEQTIFCSTINGNQLVQVTSNSIRLVSSA--GLRSEWRPPGKITIGVVSANASQVVVAGGGLALFYLEIEDGGLRE 523 (1096)
T ss_pred cccccCceEEEEccCCceEEEEecccEEEEcch--hhhhcccCCCceEEEEEeecceEEEEecCccEEEEEEeeccceee
Confidence 999999999999998889999999999999876 388999999988888888998999999988999999998877999
Q ss_pred EEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecC-eEEEEEEeC
Q 001655 471 VKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEG-ISYLLCALG 549 (1036)
Q Consensus 471 ~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~-~~~L~vgl~ 549 (1036)
+.+.+++.||+|+|++|+++++.++.+++||+|.+-.+.+..+|++.+++.+.++.+.+|+|+++..+++ ..||+|+++
T Consensus 524 ~~~~~~e~evaCLDisp~~d~~~~s~~~aVG~Ws~~~~~l~~~pd~~~~~~~~l~~~~iPRSIl~~~~e~d~~yLlvalg 603 (1096)
T KOG1897|consen 524 VSHKEFEYEVACLDISPLGDAPNKSRLLAVGLWSDISMILTFLPDLILITHEQLSGEIIPRSILLTTFEGDIHYLLVALG 603 (1096)
T ss_pred eeeheecceeEEEecccCCCCCCcceEEEEEeecceEEEEEECCCcceeeeeccCCCccchheeeEEeeccceEEEEEcC
Confidence 9999999999999999998877788899999997778888889999998888888889999999999986 899999999
Q ss_pred CCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCC
Q 001655 550 DGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAF 629 (1036)
Q Consensus 550 ~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~ 629 (1036)
||.++.|.++..++.++++|++++|++|+.|+.|.+.+.+++||+|+|||++|..++++.|+|++.+.+..+|||++.++
T Consensus 604 dG~l~~fv~d~~tg~lsd~Kk~~lGt~P~~Lr~f~sk~~t~vfa~sdrP~viY~~n~kLv~spls~kev~~~c~f~s~a~ 683 (1096)
T KOG1897|consen 604 DGALLYFVLDINTGQLSDRKKVTLGTQPISLRTFSSKSRTAVFALSDRPTVIYSSNGKLVYSPLSLKEVNHMCPFNSDAY 683 (1096)
T ss_pred CceEEEEEEEcccceEccccccccCCCCcEEEEEeeCCceEEEEeCCCCEEEEecCCcEEEeccchHHhhhhcccccccC
Confidence 99999999999999999999999999999999999889999999999999999999999999999999999999999999
Q ss_pred CCeEEEEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCC----CCCceeeEEEEEEeCCCceEE
Q 001655 630 PDSLAIAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQS----CAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 630 ~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~----~~~~~~~~~l~l~d~~t~~~i 705 (1036)
++++++++++.|+|+++++.+++++|++|++++||||+|++.+.+|+|+|.+.+. .+++.+.++++++|++|++++
T Consensus 684 ~d~l~~~~~~~l~i~tid~iqkl~irtvpl~~~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf~vl 763 (1096)
T KOG1897|consen 684 PDSLASANGGALTIGTIDEIQKLHIRTVPLGESPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTFEVL 763 (1096)
T ss_pred CceEEEecCCceEEEEecchhhcceeeecCCCChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCceeEE
Confidence 9999999999999999999999999999999999999999999999999988753 355788999999999999999
Q ss_pred EEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeC-CeEEEEEEEEecCceeEeccccCeEE
Q 001655 706 STYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVED-GKLQLIAEKETKGAVYSLNAFNGKLL 784 (1036)
Q Consensus 706 ~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~-~kl~~~~~~~~~g~v~~i~~~~g~Lv 784 (1036)
+.++|+++|.++|+++++|.++...|++|||++..|+|.+|..|||.+|++.+ ++|+++++++++|+|++++.|||+|+
T Consensus 764 ~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~Gav~aL~~fngkll 843 (1096)
T KOG1897|consen 764 SSHEFERNETALSIISCKFTDDPNTYYVVGTGLVYPDENEPVNGRIIVFEFEELNSLELVAETVVKGAVYALVEFNGKLL 843 (1096)
T ss_pred eeccccccceeeeeeeeeecCCCceEEEEEEEeeccCCCCcccceEEEEEEecCCceeeeeeeeeccceeehhhhCCeEE
Confidence 99999999999999999999988999999999999999999999999999997 89999999999999999999999999
Q ss_pred EEECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEE
Q 001655 785 AAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAV 864 (1036)
Q Consensus 785 ~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~ 864 (1036)
+|+|++|++|+|. .+++|+..|....+..++++++.+|+|+|||+|+|+++++|+.+++.|+++|||+.|+|++++
T Consensus 844 A~In~~vrLye~t----~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDlm~Sitll~y~~~eg~f~evArD~~p~Wmtav 919 (1096)
T KOG1897|consen 844 AGINQSVRLYEWT----TERELRIECNISNPIIALDLQVKGDEIAVGDLMRSITLLQYKGDEGNFEEVARDYNPNWMTAV 919 (1096)
T ss_pred EecCcEEEEEEcc----ccceehhhhcccCCeEEEEEEecCcEEEEeeccceEEEEEEeccCCceEEeehhhCccceeeE
Confidence 9999999999995 246787788888889999999999999999999999999999999999999999999999999
Q ss_pred EEeeCceEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceE
Q 001655 865 EILDDDIYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIG 944 (1036)
Q Consensus 865 ~~l~~~~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg 944 (1036)
+++++++++++|++||+++++++.++.++++++.|+..+.||+|+.|++|+.++++++.+++.....++++|||.+|+||
T Consensus 920 eil~~d~ylgae~~gNlf~v~~d~~~~td~eR~~l~~~~~~hlGelvn~f~hg~lv~~~~~s~~~~~~~vlfgTv~GsIG 999 (1096)
T KOG1897|consen 920 EILDDDTYLGAENSGNLFTVRKDSDATTDEERQILEEVGKFHLGELVNKFRHGSLVMQLGDSMIPLEPKVLFGTVNGSIG 999 (1096)
T ss_pred EEecCceEEeecccccEEEEEecCCCCchhhhhcccceeeEEeccceeeeeecceEeeccccccCCCCcEEEEEccceEE
Confidence 99999999999999999999999999999999999999999999999999999999885555555678899999999999
Q ss_pred EEEecChhHHHHHHHHHHHHHhcccCCCCCCcccccccccccccCCCCcEEehhHHHHHhcCCHHHHHHHHHhcCCC---
Q 001655 945 VIASLPHEQYLFLEKLQTNLRKVIKGVGGLNHEQWRSFNNEKKTVDAKNFLDGDLIESFLDLSRTRMDEISKTMNVS--- 1021 (1036)
Q Consensus 945 ~l~~l~~~~~~~L~~lq~~l~~~~~~~~gl~~~~~R~~~~~~~~~~~~~~iDGdll~~fl~l~~~~q~~i~~~~~~~--- 1021 (1036)
++..++++.+.+|..||++|++..+++||++|..||+++.+.+..|++|||||||+|+|++|+.+++.+|++++..+
T Consensus 1000 ~i~sl~~d~~~fL~~Lq~~irk~i~s~gglsH~~yrsf~~e~~~~P~~gfIDGDLiEsfl~l~~~~~~~i~~~~~~~~~~ 1079 (1096)
T KOG1897|consen 1000 IIVSLPQDWYDFLEELQRRIRKVIKSVGGLSHMDYRSFEFEKRTSPVKGFIDGDLIESFLDLSRSKMREIVRGLEHTESL 1079 (1096)
T ss_pred EEEecCcchhHHHHHHHHHHHHhhcccCCcchhhHhhhhcccccCCCcCcccchHHHhhhccCHHHHHHHHhhccccccc
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999766
Q ss_pred --HHHHHHHHHHHhccC
Q 001655 1022 --VEELCKRVEELTRLH 1036 (1036)
Q Consensus 1022 --~~~i~~~l~~l~~~h 1036 (1036)
++||.|.+|||+|||
T Consensus 1080 ~s~~el~k~vEel~rlh 1096 (1096)
T KOG1897|consen 1080 ASVQELLKIVEELTRLH 1096 (1096)
T ss_pred CCHHHHHHHHHHHHhcC
Confidence 999999999999999
No 2
>KOG1896 consensus mRNA cleavage and polyadenylation factor II complex, subunit CFT1 (CPSF subunit) [RNA processing and modification]
Probab=100.00 E-value=7.7e-134 Score=1148.11 Aligned_cols=1024 Identities=22% Similarity=0.342 Sum_probs=828.6
Q ss_pred CeeEEEeEEEeEeeeeccCCCCccEEEEEeCcCcEEEEEEeCCCCcEEEEEeeeccCCCCc----cCCCCCeEEECCCCC
Q 001655 1 MLDVPIYGRIATLELFRPHGEAQDFLFIATERYKFCVLQWDAESSELITRAMGDVSDRIGR----PTDNGQIGIIDPDCR 76 (1036)
Q Consensus 1 ~~~~~l~g~i~~i~~~r~~~~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s~~~~~~~~~~----~~~~~~~l~vdp~~r 76 (1036)
+++|++||+|++|++++..+..+|+|+++|++||+|+++||+++++|.|.|+|+||++..+ ....+|.++|||++|
T Consensus 69 v~~~~l~GnV~si~~~~~~gs~rD~LlL~f~~AKiSvlefD~~t~sl~TlSLHyfE~~~~~~~~~~~~~~p~vrvDPdsr 148 (1366)
T KOG1896|consen 69 VAEFKLFGNVTSIAKLPLKGSNRDALLLLFKDAKISVLEFDPQTNSLRTLSLHYFEGPEFRKGLVGRAKIPTVRVDPDSR 148 (1366)
T ss_pred EEEEEeecceeeEEEeecCCCCcceEEEEeccceEEEEEecCCccceeeeeeEEeccccccccccccccCceEEECCCCC
Confidence 4799999999999999999999999999999999999999999999999999999987543 345678999999999
Q ss_pred EEEEEecCCeEEEEeCCCCCcc----------------ccceeccc---CC--ceEEEEEeecCCCCCEEEEEEEecCCc
Q 001655 77 LIGLHLYDGLFKVIPFDNKGQL----------------KEAFNIRL---EE--LQVLDIKFLYGCAKPTIVVLYQDNKDA 135 (1036)
Q Consensus 77 ~~~~~~~~~~~~ilp~~~~~~~----------------~~~~~~~l---~~--~~i~d~~FL~~~~~ptlavL~~~~~~~ 135 (1036)
|+++..|+..++++|+...+.+ ..+|.+.+ ++ .||+|++|||||.+||+|+||++.++|
T Consensus 149 Ca~llvyg~~m~iLpf~~~e~~~~~~~~~~~~~~ss~~~pSyvi~~reLdeki~niiD~qFLhgY~ePTl~ILyep~~tw 228 (1366)
T KOG1896|consen 149 CALLLVYGLRMAILPFRVNEHLDDEELFPSGFSKSSFTAPSYVIALRELDEKIKNIIDFQFLHGYYEPTLAILYEPEQTW 228 (1366)
T ss_pred eEEEEEecceEEEeeccccccccccccccccccccccccceeEEEhhhhhhhhccceeEEeecCcccceEEEEecccccc
Confidence 9999999999999999664322 22454443 33 589999999999999999999999887
Q ss_pred c----------eEEEEEEeccCCceeeccccccccCCCCCEEEecCCCCcceEEEeCceEEEEcCCc-eeeeccCcceee
Q 001655 136 R----------HVKTYEVALKDKDFVEGPWSQNNLDNGADLLIPVPPPLCGVLIIGEETIVYCSANA-FKAIPIRPSITK 204 (1036)
Q Consensus 136 ~----------~l~~~~~~~~~~~~~~~~~~~~~lp~~~~~lip~p~~~~G~lv~~~~~i~y~~~~~-~~~~~~~~~~~~ 204 (1036)
. .+...+++++.+ -++.+|+..+||+|++...++|.|+||+||++.|.++|.+++. +.++++|.....
T Consensus 229 ~grv~~r~dt~~~vaisLni~q~-~hpVI~sv~sLP~D~~~~~~vp~piGgvLv~~~n~~iy~nqsv~~~gv~LNs~a~~ 307 (1366)
T KOG1896|consen 229 AGRVILRKDTCVLVAISLNITQK-VHPVIWSVLSLPFDCYQATAVPTPIGGVLVFTVNNLIYLNQSVSPYGVALNSYASK 307 (1366)
T ss_pred cceEEEecCcEEEEEEEcCcccc-ccceEeeeccCChhhhhceeecccCccEEEEeeeeEEEEccCCCceeEEecchhhc
Confidence 3 222344444432 3457899999999999999999999999999999999999987 466776642211
Q ss_pred -----------------EEEEEecCCCEEEEEcCccCEEEEEEEec-CcEEeeEEEEEcCccccceEEEEecCCeEEEEE
Q 001655 205 -----------------AYGRVDADGSRYLLGDHAGLLHLLVITHE-KEKVTGLKIELLGETSIASTISYLDNAVVYIGS 266 (1036)
Q Consensus 205 -----------------~~~~~~~~~~~~ll~~~~G~l~~l~l~~~-~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS 266 (1036)
|....-.+.+.++++..+|++|+|++..| ++.|+.+.+.........+|++...++++|+||
T Consensus 308 ~t~fpl~~qs~v~i~ld~a~~t~i~~dk~vis~~~Gd~y~Ltl~~D~~r~V~~~~f~k~~asvl~t~~v~~~n~llFlGS 387 (1366)
T KOG1896|consen 308 YTAFPLIPQSGVRIELDCANATWISNDKCVISLKNGDLYLLTLILDIGRSVQLLHFDKFKASVLATSIVGHGNNLLFLGS 387 (1366)
T ss_pred ccCCccccccceEEEEeeccceeecCCeEEEecCCCcEEEEEEEeccccchhhhhhhhhhcccceeeeeccCCccEEEEe
Confidence 11000124577999999999999999999 677887777666666678899999999999999
Q ss_pred eecCeeEEEEeeCC------------C---------------------C-----------CCC----------c-EEEee
Q 001655 267 SYGDSQLIKLNLQP------------D---------------------A-----------KGS----------Y-VEVLE 291 (1036)
Q Consensus 267 ~~gds~l~~~~~~~------------~---------------------~-----------~~~----------~-~~~~~ 291 (1036)
+.|||.|+++.... | + .+. + ++++|
T Consensus 388 rlgnSlll~~s~~~~~~~e~~~re~~d~~~~~~~~~~~d~~~d~~~~d~~~~~~~~~g~~~~~g~~a~~t~~~f~fevcD 467 (1366)
T KOG1896|consen 388 RLGNSLLLRFSELLQRASEGVRREEGDTESDGYSKKRVDDTQDVRRDDEKSAELFEAGSEENYGSGAQETVQPFSFEVCD 467 (1366)
T ss_pred cCCCEEEEEehhccccCCccccccccCCcCCcchhhcccchhhhhhhhhhccchhhccccccCCcccceeeeeeEEeehh
Confidence 99999999998521 0 0 000 1 79999
Q ss_pred ecccCCceeeeEEeccCC----------CC-CceEEEEeeCCCCccEEEEecCCceeEEEeeeCCCcceEEEeecCC---
Q 001655 292 RYVNLGPIVDFCVVDLER----------QG-QGQVVTCSGAYKDGSLRIVRNGIGINEQASVELQGIKGMWSLRSST--- 357 (1036)
Q Consensus 292 ~l~n~~Pi~D~~~~~~~~----------~~-~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~~~l~~~~~iw~l~~~~--- 357 (1036)
+++|+|||.||++++... ++ ..++|+|+|+|++|+|+++|+.|+|++..+++++||.++|++....
T Consensus 468 sL~NIGPi~~~avG~~~~~~~~~~gl~~~~~~~elV~~sGhgkngaL~V~r~sI~P~i~t~fel~Gc~~iWtV~~~~~~~ 547 (1366)
T KOG1896|consen 468 SLPNIGPITDFAVGKRSSASEAVEGLSPHNKCLELVATSGHGKNGALSVIRRSIRPEIATEFELPGCVDIWTVFIKGRKR 547 (1366)
T ss_pred ccccccccccceeccccchhhhccCCCCCCCeEEEEEeccCCCCcceEEEeecccceeeEEEEecCeeeEEEEEEecccc
Confidence 999999999999986431 12 2689999999999999999999999999999999999999997532
Q ss_pred --CCCcccEEEEEecCceEEEEecCCCCeeeeeecCeeccccceeeeecCCC-eEEEEecCcEEEEecCCccceeeeeCC
Q 001655 358 --DDPFDTFLVVSFISETRILAMNLEDELEETEIEGFCSQTQTLFCHDAIYN-QLVQVTSGSVRLVSSTSRELRNEWKSP 434 (1036)
Q Consensus 358 --~~~~~~~lv~S~~~~T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~-~~vQVt~~~i~l~~~~~~~~~~~w~~~ 434 (1036)
.+..|.|+++|..++|+||+.+ +++.|++.++|..+.+||++|+++++ ++|||||+++|+++.+. ..++.....
T Consensus 548 ~~~~~~h~~lilS~e~~t~il~tg--e~~~Ev~~s~f~~~~~Tl~~gnlg~~rriVQVtp~~~rllDg~~-r~lq~i~fd 624 (1366)
T KOG1896|consen 548 EEDNTQHLYLILSTESRTMILETG--EELLEVSGSGFTRDGPTLFAGNLGNERRIVQVTPSGLRLLDGDL-RMLQRIPFD 624 (1366)
T ss_pred ccccCcceEEEeecccchhhhhcc--chhhhcccceeEeccceEEEEecCCceEEEEEccceeEEecCcc-hheeEeccc
Confidence 2234789999999999999665 46999999999999999999999876 99999999999999875 467777776
Q ss_pred CCCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcE--EEE--------E---EeccCCceeEEEE-----------------
Q 001655 435 PGYSVNVATANASQVLLATGGGHLVYLEIGDGI--LTE--------V---KHAQLEYEISCLD----------------- 484 (1036)
Q Consensus 435 ~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~--l~~--------~---~~~~l~~~is~l~----------------- 484 (1036)
.+..++..++.+.++++...++.+.+|+++... +.. + ....+..-+.-+.
T Consensus 625 ~~~~vv~~sv~dpyv~v~~~~g~i~~~~l~~~s~rl~~~~~~s~~~~sv~~~~dlsg~f~~~s~l~~k~~~~~gr~~~~~ 704 (1366)
T KOG1896|consen 625 SGAIVVQTSVADPYVAVRSSEGRITLYDLEEKSHRLALHDPMSFKVVSVSLPADLSGMFTTLSDLSLKGNEANGRSSEAE 704 (1366)
T ss_pred cCCcEEEEeccCceEEEEEcCCceEEEEeccccchhhccCcccceeEEEechhhhccceEEEeeecccCccccccccccc
Confidence 777888888887777777778888888875421 100 0 0001111110000
Q ss_pred ----cC-CCCCCC----CcccEEEEEEecCCEEEEEECCCCCeeEEecCCC----------------c-cCce----eEE
Q 001655 485 ----IN-PIGENP----SYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGG----------------E-IIPR----SVL 534 (1036)
Q Consensus 485 ----~~-~~~~~~----~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~----------------~-~~p~----si~ 534 (1036)
.. .+++.+ ....+.++-...+|.++||++|++..++...... . ..+. .+.
T Consensus 705 ~~~~~~~kv~~~egg~~~~~~~~~~~~~e~g~leiy~~pd~~lVf~v~~f~~~~~~L~~~~~~~~~~~~~s~~~~l~q~~ 784 (1366)
T KOG1896|consen 705 GLQSLPCKVDDEEGGSPEQEPYWCVFVTESGTLEIYALPDFDLVFEVDMFDTGNRVLMDSRLRGPTTNKESEDLELKQLF 784 (1366)
T ss_pred ccccCCccccCCCCCCcccCceEEEEEcCCCceEEEccCCcceEEEeeccCCCcceEEeecccCccccccccchHHHHhh
Confidence 00 000000 0111444445559999999999988776421100 0 0011 111
Q ss_pred eeee-----cCeEEEEEEeCCCcEEEEEEec--CCCc--ccccee----------------e----------ecCccceE
Q 001655 535 LCAF-----EGISYLLCALGDGHLLNFLLNM--KTGE--LTDRKK----------------V----------SLGTQPIT 579 (1036)
Q Consensus 535 ~~~~-----~~~~~L~vgl~~G~l~~y~~~~--~~~~--l~~~~~----------------~----------~lG~~pv~ 579 (1036)
+.++ ..+++|+.-+.+|.+..|+..+ ..+. +..++. . ..+..-.+
T Consensus 785 ~~~L~~e~~~~e~~L~lv~~~~eil~Ykaf~~~~~~~~~~~f~kvp~~~~~~~~~p~~~~~~~~~~~~e~~~~~~~~~~~ 864 (1366)
T KOG1896|consen 785 VNPLGSEIVFKEPHLFLVVSDNEILIYKAFPQLSQGNLKVFFKKVPHNLNIRTDKPHFLCKKREGGGAEEGASVSVIVQR 864 (1366)
T ss_pred ccccchhhhccCCceEEEEeCceEEEEeeccccCccchhhhhhhCCHhhcccccCCcccchhhccccccccccccceeee
Confidence 1222 2468999999999999999775 2221 111110 0 01112236
Q ss_pred EEEE-EeCCceEEEEEcCCceEEEe-cCCcEEEeeecc-ccceeeecccCCCCCCeEEEEe-CCeEEEEEEcCC----CC
Q 001655 580 LRTF-SSKNTTHVFAASDRPTVIYS-SNKKLLYSNVNL-KEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDDI----QK 651 (1036)
Q Consensus 580 l~~~-~~~~~~~v~~~~~~p~~i~~-~~~~~~~~~~~~-~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~~----~~ 651 (1036)
+++| .+++++++|++|.+|+|+.. -++.+.++++.. .++.+++||++.+||++++|++ ++.++||.++.. ++
T Consensus 865 m~~f~~i~ghsgvfv~Gs~P~~il~t~rg~lr~h~~~gngpv~sfapfhnvn~p~gfiyvd~~~~l~i~~lp~~~~Ydn~ 944 (1366)
T KOG1896|consen 865 MTYFEDIGGHSGVFVTGSKPYLILLTFRGVLRFHPVFGNGPVGSFAPFHNVNCPRGFIYVDRQGELVICVLPEALSYDNK 944 (1366)
T ss_pred EEeeccccCeeEEEEecCCceEEEEEcccccceeeeecCCcceeeeeeeccCCCcceEEECCCceEEEEEcchhcccCCC
Confidence 7778 46789999999999966654 578888777764 6899999999999999999987 689999999885 48
Q ss_pred eEEEEEeCCCccceEEEecCCCEEEEEEeecC------CCCCc-------------eeeEEEEEEeCCCceEEEEEECCC
Q 001655 652 LHIRSIPLGEHPRRICHQEQSRTFAICSLKNQ------SCAEE-------------SEMHFVRLLDDQTFEFISTYPLDT 712 (1036)
Q Consensus 652 ~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~------~~~~~-------------~~~~~l~l~d~~t~~~i~~~~~~~ 712 (1036)
|+.|+|||+.||+.++||++.+.|+|.++.+. .++++ .+++.++|++|.+|+.++.++|++
T Consensus 945 wPvkkIpl~~T~~~vvYh~e~~vy~v~t~~~~~~~~~~~d~~e~~~~~de~~~~p~~~~f~i~LisP~sw~vi~~iefq~ 1024 (1366)
T KOG1896|consen 945 WPVKKIPLRKTPHQVVYHYEKKVYAVITSTPVPYERLGEDGEEEVISRDENVIHPEGEQFSIQLISPESWEVIDKIEFQE 1024 (1366)
T ss_pred CcccccccccchhheeeeccceEEEEEEeccceeeecccccccccccccccccccccccceeEEecCCccccccccccCc
Confidence 99999999999999999999999999996541 11111 257999999999999999999999
Q ss_pred CCeEeEEEEEEEcC-----CCceEEEEEeeeeCCCCCCCcceEEEEEEEe-----------CCeEEEEEEEEecCceeEe
Q 001655 713 FEYGCSILSCSFSD-----DSNVYYCVGTAYVLPEENEPTKGRILVFIVE-----------DGKLQLIAEKETKGAVYSL 776 (1036)
Q Consensus 713 ~E~v~si~~~~l~~-----~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~-----------~~kl~~~~~~~~~g~v~~i 776 (1036)
+|++++++.+.+.. +.++|++|||++.. +|+.+++||+++|++. ++|+|+++.++++|+|.++
T Consensus 1025 ~E~v~~~k~v~L~~~~t~~~~k~ylavGT~~~~-gEDv~~RGr~hi~diIeVVPepgkP~t~~KlKel~~eE~KGtVsav 1103 (1366)
T KOG1896|consen 1025 NEHVLHMKYVILDDEETTKGKKPYLAVGTAFIQ-GEDVPARGRIHIFDIIEVVPEPGKPFTKNKLKELYIEEQKGTVSAV 1103 (1366)
T ss_pred cceeeEEEEEEEEecccccCCcceEEEEEeecc-cccccCcccEEEEEEEEecCCCCCCcccceeeeeehhhcccceEEE
Confidence 99999999999965 24899999999998 8999999999999999 4599999999999999999
Q ss_pred ccccCeEEEEECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccC
Q 001655 777 NAFNGKLLAAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDY 856 (1036)
Q Consensus 777 ~~~~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~ 856 (1036)
|.++|+|+.|.|+||++|+|+. +-.|.+.+|++.+.++.++++.+|+|++||+|+|++|++|++++.+|++++||.
T Consensus 1104 ceV~G~l~~~~GqKI~v~~l~r----~~~ligVaFiD~~~yv~s~~~vknlIl~gDV~ksisfl~fqeep~rlsL~srd~ 1179 (1366)
T KOG1896|consen 1104 CEVRGHLLSSQGQKIIVRKLDR----DSELIGVAFIDLPLYVHSMKVVKNLILAGDVMKSISFLGFQEEPYRLSLLSRDF 1179 (1366)
T ss_pred EEeccEEEEccCcEEEEEEecc----CCcceeeEEeccceeEEehhhhhhheehhhhhhceEEEEEccCceEEEEeecCC
Confidence 9999999999999999999942 235999999999999999999999999999999999999999999999999999
Q ss_pred CcceeEEEEEeeCce---EEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcce
Q 001655 857 NANWMSAVEILDDDI---YLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPT 933 (1036)
Q Consensus 857 ~~~~~~~~~~l~~~~---~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~ 933 (1036)
.++.+++++||.++. ++++|.++||++|.|.|+++++..|+||..+++||+|..+++|.+-. .+..+.-..+.+.
T Consensus 1180 ~~l~v~s~EFLVdg~~L~flvsDa~rNi~vy~Y~Pe~~eS~~G~RLv~radfhvg~~vs~m~~lp--~~~~~e~~~~~~~ 1257 (1366)
T KOG1896|consen 1180 EPLNVYSTEFLVDGSNLSFLVSDADRNIHVYMYAPENIESLSGQRLVRRADFHVGAHVSTMFRLP--CHQNAEFGSNSPM 1257 (1366)
T ss_pred chhhceeeeeEEcCCeeEEEEEcCCCcEEEEEeCCCCccccCcceeeeeeeeEeccceeeeEecc--ccccchhccCCch
Confidence 999999999998863 89999999999999999999999999999999999999999997633 1111111122333
Q ss_pred E--EEEccccceEEEEecChhHHHHHHHHHHHHHhcccCCCCCCccccccccccc-ccCCCCcEEehhHHHHHhcCCHHH
Q 001655 934 V--IFGTVNGVIGVIASLPHEQYLFLEKLQTNLRKVIKGVGGLNHEQWRSFNNEK-KTVDAKNFLDGDLIESFLDLSRTR 1010 (1036)
Q Consensus 934 i--l~~t~~GsIg~l~~l~~~~~~~L~~lq~~l~~~~~~~~gl~~~~~R~~~~~~-~~~~~~~~iDGdll~~fl~l~~~~ 1010 (1036)
. +|||+||++|++.|++|+.||+|..||++|...++|+|||||++||...... ...+.+.+|||++|.+|..|+-++
T Consensus 1258 ~~~v~gtlDG~l~~~~Pl~e~~YRRL~~lQn~L~~~~~hv~GLNPr~yR~~~s~~~~~n~~r~ilDg~ll~~f~yl~~~e 1337 (1366)
T KOG1896|consen 1258 FYEVFGTLDGGLGHLVPLDEKTYRRLLMLQNALMDRLPHVGGLNPRAYRLLDSSLQLSNSLRSILDGELLNRFSYLSMSE 1337 (1366)
T ss_pred hhhhhcccCCceeEEecCCHHHHHHHHHHHHHHHHhhhhhcCCCHHHhhhccchhhhcCCCcccchHhHHHHhhccchhh
Confidence 4 4899999999999999999999999999999999999999999999988766 557889999999999999999999
Q ss_pred HHHHHHhcCCCHHHHHHHHHHHhcc
Q 001655 1011 MDEISKTMNVSVEELCKRVEELTRL 1035 (1036)
Q Consensus 1011 q~~i~~~~~~~~~~i~~~l~~l~~~ 1035 (1036)
|+++|+++|+++.+|+++|-||.|+
T Consensus 1338 r~elA~kiGt~~~eIl~DLvel~~~ 1362 (1366)
T KOG1896|consen 1338 REELAHKIGTTRKEILDDLVELDRL 1362 (1366)
T ss_pred HHHHHHhcCCCHHHHHHHHHHHHHH
Confidence 9999999999999999999999875
No 3
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=100.00 E-value=3.1e-126 Score=1072.73 Aligned_cols=1005 Identities=25% Similarity=0.421 Sum_probs=880.4
Q ss_pred CeeEEEeEEEeEeeeeccCCCCccEEEEEeCcCcEEEEEEeCCCCcEEEEEeeeccCCCCccCCCCCeEEECCCCCEEEE
Q 001655 1 MLDVPIYGRIATLELFRPHGEAQDFLFIATERYKFCVLQWDAESSELITRAMGDVSDRIGRPTDNGQIGIIDPDCRLIGL 80 (1036)
Q Consensus 1 ~~~~~l~g~i~~i~~~r~~~~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s~~~~~~~~~~~~~~~~~l~vdp~~r~~~~ 80 (1036)
|+++.+||+|++++.+|.++..+|+|+|+++++++++++|+.+.+.++++..+.+.+++.|+..+|.++++||.|||+++
T Consensus 53 i~~~~vFg~Irsla~~~lt~~~kD~LaV~SDSGri~il~y~~ek~~~~~~~qetfGks~~rrivpG~y~~idp~Gra~mi 132 (1205)
T KOG1898|consen 53 ICRQEVFGTIRSLAAFRLTGGTKDYLAVGSDSGRISILEYNNEKNHFEKLHQETFGKSGCRRIVPGQYLAIDPKGRAVMI 132 (1205)
T ss_pred EEEEeehhhhhhhhccccCCCCccEEEEEcCCceEEEEEechhhhccccccccccCcccceEeccccEEEEcCCccceee
Confidence 57899999999999999999999999999999999999999988889999999999999999999999999999999887
Q ss_pred Eec--CCeEEEEeCCCCCccccceecccCC----ceEEEEEeec-CCCCCEEEEEEEecCC-------------cceEEE
Q 001655 81 HLY--DGLFKVIPFDNKGQLKEAFNIRLEE----LQVLDIKFLY-GCAKPTIVVLYQDNKD-------------ARHVKT 140 (1036)
Q Consensus 81 ~~~--~~~~~ilp~~~~~~~~~~~~~~l~~----~~i~d~~FL~-~~~~ptlavL~~~~~~-------------~~~l~~ 140 (1036)
.+- +.+.+|+..+..+.++.+ .|++. ..+.||+.+. ||.+|+||.|..|+.. .+++++
T Consensus 133 save~~kLvyvlnrD~~a~ltis--Spleahk~~sic~~l~~Vd~gf~np~fa~LE~dy~~a~~d~tgeaa~~~~~~l~f 210 (1205)
T KOG1898|consen 133 SAVEKQKLVYVLNRDGAARLTIS--SPLEAHKAHSICLDLVGVDVGFENPIFAALERDYSEADNDPTGEAATMTQKVLTF 210 (1205)
T ss_pred ehhhcCcEEEEEccchhhhceec--CchhhccCCcEEEEEEEEeccCCCceEEEEeechhhcccCchhhhhhccccceeE
Confidence 774 455555544444444332 24443 3578888885 7999999999999522 368999
Q ss_pred EEEeccCCceeeccccccccCCCCCEEEecCCC---CcceEEEeCceEEEEcCCc--eeeeccCc-----------ceee
Q 001655 141 YEVALKDKDFVEGPWSQNNLDNGADLLIPVPPP---LCGVLIIGEETIVYCSANA--FKAIPIRP-----------SITK 204 (1036)
Q Consensus 141 ~~~~~~~~~~~~~~~~~~~lp~~~~~lip~p~~---~~G~lv~~~~~i~y~~~~~--~~~~~~~~-----------~~~~ 204 (1036)
|+++++. +++.+.|+ ..+++...++++||.. +.|++|++.|++.|.+... ...+|++. .++.
T Consensus 211 Yeldlgl-nhvvrk~s-~p~~~~~n~l~~VP~G~D~ps~v~vc~~n~~~y~~~~d~p~~ri~~~rr~~~L~~~~~~vliv 288 (1205)
T KOG1898|consen 211 YELDLGL-NHVVRKAS-EPVNHFGNFLLTVPGGSDGPSGVLVCAENYLLYRNLGDHPDVRIPIERRINELSDAEDGVLIV 288 (1205)
T ss_pred EEEeccc-ceeEEEcc-cccCCCceEEEEecCCCCCCcceEEecCceeeccccccCCCEEeccccccccCCccccccEEE
Confidence 9999996 77777787 4667778899999964 2479999999999999763 33444321 2222
Q ss_pred -EEEEEecCCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEecCCeEEEEEeecCeeEEEEeeCC---
Q 001655 205 -AYGRVDADGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQP--- 280 (1036)
Q Consensus 205 -~~~~~~~~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~~--- 280 (1036)
+|..-...+-++++++++|++|++++..|++.+..++++|+++++.+..|+.+++|+||++|++||+.||++..-+
T Consensus 289 ~s~~hk~k~~ff~llqt~~GD~fk~tl~~d~d~v~el~lkYfDtvp~a~~L~I~k~GfLf~~sE~~n~~lyq~~~LG~~~ 368 (1205)
T KOG1898|consen 289 SSAEHKTKSMFFFLLQTEYGDLFKLTLEHDGDNVVELRLKYFDTVPCALQLCILKTGFLFVASEFGNHRLYQFEKLGEED 368 (1205)
T ss_pred EeecccccCCeEEEEEecCCceEEEEEecCCCcceeeeeehhcCCccceEEEEeccceEEEhhhccCcceeehhhcCCCc
Confidence 2222223557889999999999999999999889999999999999999999999999999999999999998632
Q ss_pred CC---------C---------CCcEEEeeecccCCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecCCceeEEEee
Q 001655 281 DA---------K---------GSYVEVLERYVNLGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNGIGINEQASV 342 (1036)
Q Consensus 281 ~~---------~---------~~~~~~~~~l~n~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~~ 342 (1036)
|+ . -+++..+++++|+.|++|+.+++.++.+.+||++|||+|.+++|+++|+|+...+++..
T Consensus 369 ~~~s~~~~~~~~~~~~f~p~~l~nL~~~~~i~sl~p~~d~~I~~~~ne~~~qi~~~cg~~~~sslr~lR~gle~sel~~t 448 (1205)
T KOG1898|consen 369 DDFSNAMTSEEGKSVFFEPRILKNLSPVSSVESLSPLLDISIGDDSNEDTPQIYSACGRGPRSSLRILRNGLEVSELLVT 448 (1205)
T ss_pred cchhhhcccccCcceeccccccccccchhhhhccCccceeEeeccCcccchhhhhhhCcCccccchhhccccchHHHhhh
Confidence 11 0 01367889999999999999999888888999999999999999999999999999998
Q ss_pred eCC-CcceEEEeecCCCCCcccEEEEEecCceEEEEecCCCCeeeeeecCeeccccceeeeecCCCeEEEEecCcEEEEe
Q 001655 343 ELQ-GIKGMWSLRSSTDDPFDTFLVVSFISETRILAMNLEDELEETEIEGFCSQTQTLFCHDAIYNQLVQVTSGSVRLVS 421 (1036)
Q Consensus 343 ~l~-~~~~iw~l~~~~~~~~~~~lv~S~~~~T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt~~~i~l~~ 421 (1036)
++| +.+++|+++....+.+|.||++||.+.|+|++++ +.++|++++||....+|++|+.++++.+|||++++||++-
T Consensus 449 ~lp~~~ta~WTvk~~~td~ydsyivvsF~n~TlVLsIg--esveEvtdsgFls~~~Tl~~~l~Gd~slVQi~~d~iRhi~ 526 (1205)
T KOG1898|consen 449 ELPGNPTATWTVKKNITDVYDSYIVVSFVNGTLVLSIG--ESVEEVTDSGFLSTTPTLACSLMGDDSLVQIHPDGIRHIR 526 (1205)
T ss_pred ccCCCCceEEEEcCccccccceEEEEEeeccEEEEEcc--hhHHHhhhcccccCCceEEEEEecCCcEEEEchhhhhhcc
Confidence 888 6789999998777899999999999999999998 4699999999999999999999999999999999999997
Q ss_pred cCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcC-cEEEEE-EeccCCceeEEEEcCCCCCCCCcccEEE
Q 001655 422 STSRELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGD-GILTEV-KHAQLEYEISCLDINPIGENPSYSQIAA 499 (1036)
Q Consensus 422 ~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~-~~l~~~-~~~~l~~~is~l~~~~~~~~~~~~~~~~ 499 (1036)
... ++.+|.+|++.+|+.++++..++++++++++++||+++. +++.+. ++.+++++++|+++.+.+++++.+.+++
T Consensus 527 ~~~--r~~ew~~P~~~~Iv~~avnr~qiVvalSngelvyfe~d~sgql~E~~er~tl~~~vac~ai~~~~~g~krsrfla 604 (1205)
T KOG1898|consen 527 PTK--RINEWKTPERVRIVKCAVNRRQIVVALSNGELVYFEGDVSGQLNEFTERVTLSTDVACLAIGQDPEGEKRSRFLA 604 (1205)
T ss_pred ccc--ccccccCCCceEEEEEeecceEEEEEccCCeEEEEEeccCccceeeeeeeeeceeehhhccCCCCcchhhcceee
Confidence 764 788999999999999999999999999999999999976 778775 7789999999999998887778899999
Q ss_pred EEEecCCEEEEEECCC---CCeeEEecCCCccCceeEEeeeec-------CeEEEEEEeCCCcEEEEEEecCCCccccce
Q 001655 500 VGMWTDISVRIFSLPD---LNLITKEHLGGEIIPRSVLLCAFE-------GISYLLCALGDGHLLNFLLNMKTGELTDRK 569 (1036)
Q Consensus 500 vg~w~~~~i~i~~l~~---l~~v~~~~l~~~~~p~si~~~~~~-------~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~ 569 (1036)
+|+. ++++++++|.- +..+..|.++ ..|.++++.+.+ +..||++|++||.++++.+|.-.|.|.+.|
T Consensus 605 ~a~~-d~~vriisL~p~d~l~~ls~q~l~--~~~~s~~iv~~~~~~~~~~~~L~l~~GL~NGvllR~~id~v~G~l~d~r 681 (1205)
T KOG1898|consen 605 LASV-DNMVRIISLDPSDCLQPLSVQGLS--SPPESLCIVEMEATGGTDVAQLYLLIGLRNGVLLRFVIDTVTGQLLDIR 681 (1205)
T ss_pred eecc-ccceeEEEecCcceEEEccccccC--CCccceEEEEecccCCccceeEEEEecccccEEEEEEecccccceeeeh
Confidence 9999 99999999852 3444556666 578888888764 267899999999999999999999999999
Q ss_pred eeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCC
Q 001655 570 KVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDI 649 (1036)
Q Consensus 570 ~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~ 649 (1036)
++++|.+||+|.++...+.+.+++.+++||+.|..++++..+|++..++..+++|.+..||++++++..+.++|-.++..
T Consensus 682 tR~lG~~pvkLf~~~~~~~s~vL~lSsr~wl~y~~~~~~h~t~Isy~~l~~as~~~S~qcpeGiv~i~~n~l~i~~~~~~ 761 (1205)
T KOG1898|consen 682 TRFLGLRPVKLFPISMRGQSDVLALSSRPWLLYTYQQEFHLTPISYSTLEHASPFCSEQCPEGIVAISKNTLRIIALDKL 761 (1205)
T ss_pred eeeeccccceEEEEeecCcceeEEecCChhhhhhhcceeeeecccccchhccccccccCCCcchhhhhhhhhheeeehhh
Confidence 99999999999999888999999999999999999999999999999999999999999999999999999999999988
Q ss_pred C-CeEEEEEeCCCccceEEEecCCCEEEEEEeecC------------------CCCCc----------------------
Q 001655 650 Q-KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQ------------------SCAEE---------------------- 688 (1036)
Q Consensus 650 ~-~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~------------------~~~~~---------------------- 688 (1036)
. .++.+.+|++.|||++++||+++++++++.+.. ..+++
T Consensus 762 g~~~n~~~~~l~~tprkvv~h~es~lLii~~td~~~~~~~~a~~~~~~~g~v~~s~~~~e~e~g~em~~~~~~~~~~~~v 841 (1205)
T KOG1898|consen 762 GKVLNVDGFPLAYTPRKVVIHPESGLLIIGRTDHNATLTKDARKNQMEAGGVLESGEEKEDEMGGEMEIIGREEVLPENV 841 (1205)
T ss_pred cccccccccccccCcceEEEecCCCeEEEEEecccchhhHHHhhhhhhcccccccccccchhhccchhhhcccccccccc
Confidence 5 579999999999999999999999999987641 00000
Q ss_pred --------eeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCc-eEEEEEeeeeCCCC-CCCcceEEEEEEEe-
Q 001655 689 --------SEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSN-VYYCVGTAYVLPEE-NEPTKGRILVFIVE- 757 (1036)
Q Consensus 689 --------~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~-~~i~VGT~~~~~~e-~~~~~Gri~v~~i~- 757 (1036)
.|.++++++|+.+.+.+..+++..||...|++.+.|++... .+.+||++....-+ ..-.+|++|.|++.
T Consensus 842 ~~~p~a~~~w~s~I~~~d~~s~~~~~~~~l~~ne~a~~v~~~~fs~~~~~~~~~v~~~~~~~l~~~~~~~g~~ytyk~~~ 921 (1205)
T KOG1898|consen 842 YGSPRAGNGWVSSIRVFDPKSGKIICLVELGQNEAAFSVCAVDFSSSEYQPFVAVGVATTEQLDSKSISSGFVYTYKFVR 921 (1205)
T ss_pred ccCcccccCccceEEEEcCCCCceEEEEeecCCcchhheeeeeeccCCCceEEEEEeeccccccccccCCCceEEEEEEe
Confidence 15679999999999999999999999999999999987444 59999998754211 12267999999988
Q ss_pred -CCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEeeecCCCccchhccccccc-ceEEEEEEEeCCEEEEEeccc
Q 001655 758 -DGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWMLRDDGTRELQSECGHHG-HILALYVQTRGDFIVVGDLMK 835 (1036)
Q Consensus 758 -~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~-~~~~~~l~~~~~~I~vgD~~~ 835 (1036)
+.+|+++|+++++|+|.|||+|+|++++|+|+.+++|++ |+++|.++|.... +..++++++.+.+|+|||+.+
T Consensus 922 ~g~~lellh~T~~~~~v~Ai~~f~~~~LagvG~~l~~Ydl-----G~K~lLRk~e~k~~p~~Is~iqt~~~RI~VgD~qe 996 (1205)
T KOG1898|consen 922 NGDKLELLHKTEIPGPVGAICPFQGRVLAGVGRFLRLYDL-----GKKKLLRKCELKFIPNRISSIQTYGARIVVGDIQE 996 (1205)
T ss_pred cCceeeeeeccCCCccceEEeccCCEEEEecccEEEEeeC-----ChHHHHhhhhhccCceEEEEEeecceEEEEeeccc
Confidence 448999999999999999999999999999999999996 8899999988776 457888999999999999999
Q ss_pred cEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCCCCCCcc------------------ccc
Q 001655 836 SISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNSEGATDE------------------ERG 897 (1036)
Q Consensus 836 Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~~~~~~~------------------~~~ 897 (1036)
|+.+++|++++++|+.+|.|+.|||+++++++|+++++++|++||+++++.+++.+... ..+
T Consensus 997 SV~~~~y~~~~n~l~~fadD~~pR~Vt~~~~lD~~tvagaDrfGNi~~vR~P~d~~e~~~edpt~~k~~~~~g~lN~~~~ 1076 (1205)
T KOG1898|consen 997 SVHFVRYRREDNQLIVFADDPVPRHVTALELLDYDTVAGADRFGNIAVVRIPPDVSEEASEDPTELKIAWEQGFLNDAPQ 1076 (1205)
T ss_pred eEEEEEEecCCCeEEEEeCCCccceeeEEEEecCCceeeccccCcEEEEECCCcchhhhccCCccccceecccccccccH
Confidence 99999999999999999999999999999999999999999999999999987654321 125
Q ss_pred ceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEec-ChhHHHHHHHHHHHHHhcccCCCCCCc
Q 001655 898 RLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASL-PHEQYLFLEKLQTNLRKVIKGVGGLNH 976 (1036)
Q Consensus 898 ~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l-~~~~~~~L~~lq~~l~~~~~~~~gl~~ 976 (1036)
|.+...+|++|+.++++.+.++. ...++.++|+|..|+||+|+|+ +++++++++.+|..|++..++++|.+|
T Consensus 1077 K~~~i~~f~v~Dvits~q~~~~i-------~~a~e~~iy~tl~GtiG~f~p~~s~~d~~Ff~~~e~~~r~e~ppl~GrDH 1149 (1205)
T KOG1898|consen 1077 KVQLISQFFVGDVITSLQKVSSI-------PGARESLIYTTLLGTIGVFAPFLSREDVDFFQHLEMHMRKEYPPLLGRDH 1149 (1205)
T ss_pred hhhhhhhccccCeeeeceeeeec-------cCCcceeeeeeccccceEEeecccccchHHHHHHHHhccccCCcccCcch
Confidence 67888999999999999887654 3457899999999999999999 566899999999999999999999999
Q ss_pred ccccccccccccCCCCcEEehhHHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHHh
Q 001655 977 EQWRSFNNEKKTVDAKNFLDGDLIESFLDLSRTRMDEISKTMNVSVEELCKRVEELT 1033 (1036)
Q Consensus 977 ~~~R~~~~~~~~~~~~~~iDGdll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l~ 1033 (1036)
.+||++++ |.|.+|||||||+|+.|+..+|++||++++++++||.|+||+++
T Consensus 1150 ~~yRsyy~-----Pvk~VIDGDlceqF~~L~~~~Qe~va~el~~ti~eI~kkledir 1201 (1205)
T KOG1898|consen 1150 LEYRSYYA-----PVKKVIDGDLCEQFLRLEENQQEEVAEELDRTIEEISKKLEDIR 1201 (1205)
T ss_pred hhhhhhcc-----chhhcccHHHHHHHhhCCHHHHHHHHhcccCCHHHHHHHHHHHH
Confidence 99999999 89999999999999999999999999999999999999999987
No 4
>COG5161 SFT1 Pre-mRNA cleavage and polyadenylation specificity factor [RNA processing and modification]
Probab=100.00 E-value=2.3e-91 Score=768.78 Aligned_cols=1006 Identities=16% Similarity=0.234 Sum_probs=754.7
Q ss_pred eEEEeEEEeEeeeeccCCCCccEEEEEeCcCcEEEEEEeCCCCcEEEEEeeeccCCCCcc----CCCCCeEEECCCCCEE
Q 001655 3 DVPIYGRIATLELFRPHGEAQDFLFIATERYKFCVLQWDAESSELITRAMGDVSDRIGRP----TDNGQIGIIDPDCRLI 78 (1036)
Q Consensus 3 ~~~l~g~i~~i~~~r~~~~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s~~~~~~~~~~~----~~~~~~l~vdp~~r~~ 78 (1036)
++.++|.|++|..+....+++|.|+++|..+|+++++||.+.+.|.|+|+|+++..+.-. ...-..+.-||.+-|
T Consensus 54 e~~~~e~~t~I~~~pq~~se~~~lll~t~~akis~lrf~sq~n~f~TislhyyeGKfkgksLvelak~stle~D~~ssc- 132 (1319)
T COG5161 54 EHMLLEKVTQIEKYPQISSEQDGLLLLTHRAKISLLRFDSQANEFRTISLHYYEGKFKGKSLVELAKFSTLEFDIRSSC- 132 (1319)
T ss_pred HHhhhhhhhhhhhcccccCccceEEEEeccceEEEEEehhhcccceeEEEeeeccccCCchhhhhhhhhheeeccCccc-
Confidence 567889999999987778899999999999999999999999999999999998875321 222246788888866
Q ss_pred EEEecCCeEEEEeCCCCCc-------------------------------cc-------------cceec---ccC--Cc
Q 001655 79 GLHLYDGLFKVIPFDNKGQ-------------------------------LK-------------EAFNI---RLE--EL 109 (1036)
Q Consensus 79 ~~~~~~~~~~ilp~~~~~~-------------------------------~~-------------~~~~~---~l~--~~ 109 (1036)
+++.+++....+||....+ +. .++.+ .+. ..
T Consensus 133 aLlfneDi~~flpfhvnkndddev~~d~D~~~~~~~~~h~~i~psqgtntfnkrkrt~~~~kfsaPs~Vl~~seld~~ik 212 (1319)
T COG5161 133 ALLFNEDIGNFLPFHVNKNDDDEVRIDVDLGMFQMSKRHFSIFPSQGTNTFNKRKRTLFPGKFSAPSKVLKFSELDGKIK 212 (1319)
T ss_pred hhhhhhhhhhcccccccCCccccccccccccHHHHHHHHhhcCCCCCccccchhhhhhcCCcccCceeEEEehhhhcccc
Confidence 6678888888888753211 00 01111 122 26
Q ss_pred eEEEEEeecCCCCCEEEEEEEecCCcce----------EEEEEEeccCCceeeccccccccCCCCCEEEecCCCCcceEE
Q 001655 110 QVLDIKFLYGCAKPTIVVLYQDNKDARH----------VKTYEVALKDKDFVEGPWSQNNLDNGADLLIPVPPPLCGVLI 179 (1036)
Q Consensus 110 ~i~d~~FL~~~~~ptlavL~~~~~~~~~----------l~~~~~~~~~~~~~~~~~~~~~lp~~~~~lip~p~~~~G~lv 179 (1036)
+|+|++||.+|.+||+|+||++...|.+ ...+.+|++-.... .+-....||+|-+..+|+| .|.|+
T Consensus 213 niiD~~FL~ny~~PTvallY~Pkl~~~~~~ti~k~p~~~~v~Tldl~~~~sa-VI~~~~~lP~d~~~~v~~p---~Gall 288 (1319)
T COG5161 213 NIIDFVFLENYSIPTVALLYDPKLSLPRKYTILKNPYNAIVFTLDLGAGRSA-VIDEFLVLPRDFRVTVAGP---VGALL 288 (1319)
T ss_pred ccEEEEeeccCCCceEEEEecccccccceeEeecCceeEEEEEEecCcchhh-hhHhHhcCCceEEEEEecc---cceEE
Confidence 9999999999999999999998876631 22356666543322 2334568999999999988 49999
Q ss_pred EeCceEEEEcCCc-eeeeccCcce----------------eeEEE------EEe---cCCCEEEEEcCccCEEEEEEEec
Q 001655 180 IGEETIVYCSANA-FKAIPIRPSI----------------TKAYG------RVD---ADGSRYLLGDHAGLLHLLVITHE 233 (1036)
Q Consensus 180 ~~~~~i~y~~~~~-~~~~~~~~~~----------------~~~~~------~~~---~~~~~~ll~~~~G~l~~l~l~~~ 233 (1036)
+|.|.++|++..+ ..++|+|... +.|.. ++. .....+++++-+|+.|+|.+..|
T Consensus 289 ~g~neli~idstg~~~~I~lNs~~~k~~~~~~v~d~s~~d~n~~~~gttsIwipsSK~~~etl~l~dl~g~~yyl~~~~d 368 (1319)
T COG5161 289 FGSNELILIDSTGSSYTIPLNSMSEKYGGNKIVEDISLSDVNCFSRGTTSIWIPSSKCLIETLFLGDLNGDRYYLRISMD 368 (1319)
T ss_pred EecccEEEEecCCcEEEeechhhHHHhcCCceEeecccceeeEeecCceeeeccCcccccceEEEEecCCCEEEEEEEec
Confidence 9999999999887 4557766411 11111 111 12256799999999999999999
Q ss_pred CcEEeeEEEEEcC-------ccccceEEEEecCCeEEEEEeecCeeEEEEeeCC------------------C-------
Q 001655 234 KEKVTGLKIELLG-------ETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQP------------------D------- 281 (1036)
Q Consensus 234 ~~~v~~l~i~~~~-------~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~~------------------~------- 281 (1036)
|+.+.++++..+. ..+.++|+..+++.++|.|+..+||.+++|.... |
T Consensus 369 gk~iigfdi~~L~~e~dllk~~s~~~Cv~~~n~~l~f~g~g~~ns~vlr~~~l~~tiEtR~~eG~~~l~g~nDeEmdD~y 448 (1319)
T COG5161 369 GKRIIGFDIASLEFEGDLLKKGSAVSCVGHVNNLLFFGGVGDSNSRVLRIKSLLPTIETRASEGVGPLEGGNDEEMDDEY 448 (1319)
T ss_pred cceeeccceeeeeeeccccccCCCCeeEEEcCceEEEEEecCCceEEEEecccCCchhhhhhcCCCcccCCChhhhhhhh
Confidence 9998887666542 4689999999999999999999999999998510 0
Q ss_pred ---C--------------CCCc-EEEeeecccCCceeeeEEeccC--------CCCCceEEEEeeCCCCccEEEEecCCc
Q 001655 282 ---A--------------KGSY-VEVLERYVNLGPIVDFCVVDLE--------RQGQGQVVTCSGAYKDGSLRIVRNGIG 335 (1036)
Q Consensus 282 ---~--------------~~~~-~~~~~~l~n~~Pi~D~~~~~~~--------~~~~~~lv~~sG~g~~g~l~~lr~gi~ 335 (1036)
| .++| ++.++.+.|.|||+||++++.+ +.+...+|+.+|.+..|+|.+++..+.
T Consensus 449 ~apEn~l~~n~~~~v~~~~~p~d~el~~~l~n~gpitdfavgkv~v~kglP~pN~g~l~lV~t~G~ds~~~l~V~~ts~~ 528 (1319)
T COG5161 449 SAPENKLFGNKEQEVRRQDEPYDAELFNALSNAGPITDFAVGKVDVEKGLPIPNIGLLNLVVTKGSDSEAALAVEGTSLE 528 (1319)
T ss_pred cccccccccCcccceeeccCcchhHHhhhhccCCcccceeeeeccceecCCCCCccceeeEEeccCCCcceEEEEecccc
Confidence 0 1123 6789999999999999998754 236678999999999999999999999
Q ss_pred eeEEEeeeCCCcceEEEeecCCC---CCcccEEEEEecCceEEEEecCCCCeeeeeecCeeccccceeeeecCC-CeEEE
Q 001655 336 INEQASVELQGIKGMWSLRSSTD---DPFDTFLVVSFISETRILAMNLEDELEETEIEGFCSQTQTLFCHDAIY-NQLVQ 411 (1036)
Q Consensus 336 ~~~~~~~~l~~~~~iw~l~~~~~---~~~~~~lv~S~~~~T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~-~~~vQ 411 (1036)
|++...+.+.+++.+|+++.... ..-..|+++|...+|.+|+.++ ++.+.....|..+..|++.+.+++ +++||
T Consensus 529 P~I~~~~~fi~~e~vw~~kI~g~lr~~~~~~~~~ls~~s~S~If~~~e--~f~l~~~g~~~rd~~Tl~~~~fgee~rvVQ 606 (1319)
T COG5161 529 PCICTVSSFIPLEIVWSQKIRGYLRCSRALDFYILSRVSDSRIFRWSE--EFLLEVSGEYTRDVNTLLFVEFGEENRVVQ 606 (1319)
T ss_pred ceeeehccccchhheeehhccceehhcceeeEEEeecccccceeeccc--cceeeecceeeccccEEEeeeccCcceEEE
Confidence 99999999999999999986431 1124689999999999998864 577777789999999999999985 59999
Q ss_pred EecCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcC--cEEEEEEeccC--CceeEEEEcCC
Q 001655 412 VTSGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGD--GILTEVKHAQL--EYEISCLDINP 487 (1036)
Q Consensus 412 Vt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~--~~l~~~~~~~l--~~~is~l~~~~ 487 (1036)
|||+.+++++.+- +..+...+.. +.|.+.++.+..+++..+++.+..|+.+. .++..+...+. +.....+-+..
T Consensus 607 vtp~~l~~yD~~l-R~l~~~~F~~-~~V~~~Sv~Dp~ilvv~~~g~i~~f~~~ekn~rL~k~dl~~~l~d~k~~s~v~~d 684 (1319)
T COG5161 607 VTPSYLLRYDQDL-RMLGRVEFAS-RAVEARSVRDPLILVVRDSGKILTFYDREKNMRLFKIDLVTCLADAKNKSFVLSD 684 (1319)
T ss_pred ecchHhhhhcccc-eeeeeEeece-eeeEEEeccCCEEEEEEecCceEEEEehhhhchhccCChHHHHHhhhhheEeccC
Confidence 9999999998774 4555555432 24777776655555555455555556543 12222111000 00001111100
Q ss_pred C--------CC-CCCcccEEEEEEecCCEEEEEECCCCCeeEE---------------ecCCCcc--Cc--eeEEeeeec
Q 001655 488 I--------GE-NPSYSQIAAVGMWTDISVRIFSLPDLNLITK---------------EHLGGEI--IP--RSVLLCAFE 539 (1036)
Q Consensus 488 ~--------~~-~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~---------------~~l~~~~--~p--~si~~~~~~ 539 (1036)
. +- ..+....+..++..+..+....-+.+..+.. ..+..+. .| ..++++.++
T Consensus 685 sN~~g~f~ig~~~Sq~e~~l~~~~~~~~q~~~~~s~~~D~~~e~dg~dQlte~~~~~tynl~d~~f~lpsi~~~mVa~lg 764 (1319)
T COG5161 685 SNSLGIFDIGKRISQLEPCLVKGLPYAIQFSPEASPAMDLAGEEDGDDQLTEISMSLTYNLIDMLFRLPSIGNYMVAYLG 764 (1319)
T ss_pred cccccceecccchhhhchhhhhcCcccceeccccCcchhhccccccchhhhhHHHHHHHhhhhhhccChhhhhhhhHhhc
Confidence 0 00 0011112222222111111111111111111 1111111 12 122333333
Q ss_pred ---CeEEEEEEeCCCcEEEEEEecCCCc---cccce-eeec-C---------ccc---eEEEEEEeCCceEEEEEcCCce
Q 001655 540 ---GISYLLCALGDGHLLNFLLNMKTGE---LTDRK-KVSL-G---------TQP---ITLRTFSSKNTTHVFAASDRPT 599 (1036)
Q Consensus 540 ---~~~~L~vgl~~G~l~~y~~~~~~~~---l~~~~-~~~l-G---------~~p---v~l~~~~~~~~~~v~~~~~~p~ 599 (1036)
.++||+..+..|.++.|+-...... +.-.| ...+ | ... +.+...+..+++.+|++|..|+
T Consensus 765 ~D~keeyLf~~s~~~EI~~yk~~l~r~~~f~~nvTRndlAitGaPdna~~Ka~sSV~ri~m~f~~~vghs~~fvTg~~pf 844 (1319)
T COG5161 765 LDLKEEYLFDNSLSSEIVFYKTHLPRHVSFNLNVTRNDLAITGAPDNADIKAFSSVGRIDMVFIKAVGHSFMFVTGKGPF 844 (1319)
T ss_pred ccccchheehhhcCceEEEEeecccccchhhhhcchhhhhccCCCcchhhhhcccccceeEEEeeccCeEEEEEcCCccE
Confidence 4689999999999999986543211 00000 0001 1 111 2333335668999999999999
Q ss_pred EEEec-CCcEEEeeeccccceeeecccCCCCCCeEEEEe-CCeEEEEEEcCC-----CCeEEEEEeCCCccceEEEecCC
Q 001655 600 VIYSS-NKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDDI-----QKLHIRSIPLGEHPRRICHQEQS 672 (1036)
Q Consensus 600 ~i~~~-~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~~-----~~~~~~~i~l~~tp~~i~y~~~~ 672 (1036)
++.+. +..-.+.+...-++.+++||+. .+.++++ ...+++|+.... +||+.++++++.|..+++||+..
T Consensus 845 l~~s~~~s~~k~f~~gNIPlvsv~p~s~----rgy~~Vd~~~~vr~~~~~~dn~y~gnK~p~k~~~~~Ktlqklvyh~~~ 920 (1319)
T COG5161 845 LCRSRYTSSSKAFHRGNIPLVSVIPLSK----RGYLMVDNVLGVRASQYVFDNGYVGNKNPVKRTPKHKTLQKLVYHCAG 920 (1319)
T ss_pred EEEEeccCCcceeecCCCceeeeeeccc----ccEEEEecccceeEEEEEeccceecccCceeeccccccccceeeeccc
Confidence 99764 2222333444457889999986 5777776 578899998765 48999999999999999999999
Q ss_pred CEEEEEEeec---CCCCCc---------------eeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcC-----CCc
Q 001655 673 RTFAICSLKN---QSCAEE---------------SEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSD-----DSN 729 (1036)
Q Consensus 673 ~~~~v~~~~~---~~~~~~---------------~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~-----~~~ 729 (1036)
..|+|.++++ ++.+|+ ..++.+.|++|++|++||+|+|+++|.+.+++...+.. .++
T Consensus 921 ~~~~Vgsc~~~~f~~~gEdgE~~i~~D~Nvphaeg~~~~vdL~spksw~vID~yef~~ne~v~~i~~~~l~~~~~tk~k~ 1000 (1319)
T COG5161 921 RYMVVGSCEEAGFSPKGEDGESGIPVDTNVPHAEGYRFYVDLYSPKSWEVIDTYEFDENEYVFHIKYLILDDMQGTKGKS 1000 (1319)
T ss_pred eEEEEEeeeecCccccCCCCCccCccCCCCcccccceeeEEEecCcceeEeeeeecccceeeeeeeeeeeeccccccCCC
Confidence 9999998865 233332 25799999999999999999999999999999988764 348
Q ss_pred eEEEEEeeeeCCCCCCCcceEEEEEEEe-----------CCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEeee
Q 001655 730 VYYCVGTAYVLPEENEPTKGRILVFIVE-----------DGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWML 798 (1036)
Q Consensus 730 ~~i~VGT~~~~~~e~~~~~Gri~v~~i~-----------~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~~ 798 (1036)
+||+|||++.. +|+.|.+||+++|++. +.|||++..++++|.|..+|+++|+++.|+|+|+.+++++.
T Consensus 1001 pyi~vgtt~~~-gED~p~rG~~hv~eII~VVP~pg~P~t~~KLK~~~~Ee~kGTV~~vcEV~G~~~~~qgqKV~Vr~i~~ 1079 (1319)
T COG5161 1001 PYILVGTTFIE-GEDRPARGRLHVLEIISVVPSPGSPFTDCKLKVLGIEETKGTVVRVCEVRGKIALCQGQKVMVRKIDR 1079 (1319)
T ss_pred ceEEEEeeecc-cCccCCcCceEEEEEEEecCCCCCCcccceeeEEehhhcccEEEEEEEEccEEEeccCcEEEEEEecc
Confidence 99999999988 8999999999999999 46999999999999999999999999999999999999853
Q ss_pred cCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCc---eEEEE
Q 001655 799 RDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDD---IYLGA 875 (1036)
Q Consensus 799 ~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~---~~l~~ 875 (1036)
+++ +.+.++++.+++..++++.+|++++||+|++++|+.|+.++.+|+.+++....+.+++.+||..+ .++++
T Consensus 1080 -~~~---iipV~F~Dl~~ft~s~k~~~Nlll~gD~~qg~~F~gF~~ePyRm~l~s~s~~~~n~~s~efLv~G~~lyf~~~ 1155 (1319)
T COG5161 1080 -SSG---IIPVGFYDLHIFTSSIKVVKNLLLAGDIYQGLSFFGFQSEPYRMHLISSSEPLRNATSTEFLVTGNELYFLCC 1155 (1319)
T ss_pred -cCC---cceeEEEeeeeeeehhhhhhheeehhhhhcCcEEEEecCCcEEEEEecCCchhhcchhhHhhccCCeeEEEEE
Confidence 334 88999999999999999999999999999999999999999999999999999999999999875 37899
Q ss_pred ccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCC--CCCCCcceEEEEccccceEEEEecChhH
Q 001655 876 ENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPD--SDVGQIPTVIFGTVNGVIGVIASLPHEQ 953 (1036)
Q Consensus 876 D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~--~~~~~~~~il~~t~~GsIg~l~~l~~~~ 953 (1036)
|.+||++++.|.|+.+.+..|+||..++.||+|...++|.-. |+..+ +......+.+|+-+||++.+++||+++.
T Consensus 1156 Da~gnih~l~Y~P~np~S~sG~RLV~rssFtlhs~~~~m~ll---Prn~efG~~~~~~f~~v~~~sdG~l~~vvpisd~~ 1232 (1319)
T COG5161 1156 DAKGNIHGLTYSPNNPISMSGARLVKRSSFTLHSAEIKMNLL---PRNSEFGAGFKKNFIMVYSRSDGMLIHVVPISDAH 1232 (1319)
T ss_pred cCCCCEEEEecCCCCccccCcceeEeeccccccchhhhhhhc---cchhhhCCCCCCceeEEEEccCCcEEEEeccCHHH
Confidence 999999999999999999999999999999999999887432 22211 1233456899999999999999999999
Q ss_pred HHHHHHHHHHHHhcccCCCCCCccccccccccc-ccCCCCcEEehhHHHHHhcCCHHHHHHHHHhcCCCH-HHHHHHH
Q 001655 954 YLFLEKLQTNLRKVIKGVGGLNHEQWRSFNNEK-KTVDAKNFLDGDLIESFLDLSRTRMDEISKTMNVSV-EELCKRV 1029 (1036)
Q Consensus 954 ~~~L~~lq~~l~~~~~~~~gl~~~~~R~~~~~~-~~~~~~~~iDGdll~~fl~l~~~~q~~i~~~~~~~~-~~i~~~l 1029 (1036)
|++|..+|+++...+.++|||||++||-....+ ...+.+..+|+.++..|-.|+-+.|++||+++|+-. .+++.+|
T Consensus 1233 YrrL~~IQ~~i~~r~~~vgGLNpr~yRL~~d~~~~~~s~r~~ld~~ii~~F~y~~~~~r~sva~kaGr~~~~e~~D~i 1310 (1319)
T COG5161 1233 YRRLLGIQTAIMARLKSVGGLNPRDYRLNSDIHLHSLSLRSPLDLHIINLFSYFDMSTRESVASKAGRIDRKEISDMI 1310 (1319)
T ss_pred HHHHHHHHHHHHHHHHhhcCCChhhhhhccCHHHhcCCcccchhhhhhhhhhhcchhhhhHHHhhcCCchHHHHHHHH
Confidence 999999999999999999999999999865433 345778999999999999999999999999999854 4555443
No 5
>PF10433 MMS1_N: Mono-functional DNA-alkylating methyl methanesulfonate N-term; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 2B5N_C 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A ....
Probab=100.00 E-value=2.3e-62 Score=578.12 Aligned_cols=450 Identities=40% Similarity=0.665 Sum_probs=335.7
Q ss_pred cEEEEEeCcCcEEEEEEeCCCCcEEE--E-EeeeccCCCCccCCCCCeEEECCCCCEEEEEecCCeEEEEeCCCC----C
Q 001655 24 DFLFIATERYKFCVLQWDAESSELIT--R-AMGDVSDRIGRPTDNGQIGIIDPDCRLIGLHLYDGLFKVIPFDNK----G 96 (1036)
Q Consensus 24 D~Llv~~~~~~l~il~~~~~~~~~~t--~-s~~~~~~~~~~~~~~~~~l~vdp~~r~~~~~~~~~~~~ilp~~~~----~ 96 (1036)
|+|+|+|+++++++++|+++++++.+ + ....+.+++.|+..+|++++|||+|||+|+++|+|.+.|+|+++. .
T Consensus 1 D~L~v~tdsg~l~~l~~~~~~~~~~~~~v~~~~~~~~~~~r~~~~G~~l~vDP~~R~i~v~a~e~~~~v~~l~~~~~~~~ 80 (504)
T PF10433_consen 1 DSLVVTTDSGKLSILEYDPSTHGFFKEFVHQWEPLSKSGSRLSQPGQYLAVDPSGRCIAVSAYEGNFLVYPLNRSLDSDI 80 (504)
T ss_dssp -EEEEEETTTEEEEEEEEEETTEE-E-EEEEEEE---SSSEB-TT--EEEE-TTSSEEEEEEBTTEEEEEE-SS----T-
T ss_pred CEEEEEECCCCEEEEEEECCCCccceeeEEEeEecCCCCCChhcCCcEEEECCcCCEEEEEecCCeEEEEEecccccccc
Confidence 89999999999999999998887743 2 235677888899999999999999999999999999999999881 1
Q ss_pred ccccceeccc-CCceEEEEEeec---CCCCCEEEEEEEecCCcceEEEEEEeccCC-ceee-----c--cccccccCCCC
Q 001655 97 QLKEAFNIRL-EELQVLDIKFLY---GCAKPTIVVLYQDNKDARHVKTYEVALKDK-DFVE-----G--PWSQNNLDNGA 164 (1036)
Q Consensus 97 ~~~~~~~~~l-~~~~i~d~~FL~---~~~~ptlavL~~~~~~~~~l~~~~~~~~~~-~~~~-----~--~~~~~~lp~~~ 164 (1036)
.....++.|+ ++.+|+|||||+ ++++|+||+||.+...+.++.+|+|+..+. +.+. . .+...++ +
T Consensus 81 ~~~~~~~~pi~s~~~i~~~~FL~~~~~~~~p~la~L~~~~~~~~~~~~y~w~~~~~l~~~~~~~~~~~~l~~~~~~---p 157 (504)
T PF10433_consen 81 AFSPHINSPIKSEGNILDMCFLHPSVGYDNPTLAILYVDSQRRTHLVTYEWSLDDGLNHVISKSTLPIRLPNEDEL---P 157 (504)
T ss_dssp TT---EEEE--S-SEEEEEEEES---S-SS-EEEEEEEETT-EEEEEEEE--------EETTTTEEEE--EEEE-T---T
T ss_pred cccccccccccCCceEEEEEEEecccCCCCceEEEEEEEecccceeEEEeeecccccceeeeeccccccccccCCC---c
Confidence 2223345666 678999999999 899999999999988888999999877641 1111 1 1222233 4
Q ss_pred CEEEecCCCCcceEEEeCceEEEEcCCc------eeeeccC----cceeeEEEE------EecCCCEEEEEcCccCEEEE
Q 001655 165 DLLIPVPPPLCGVLIIGEETIVYCSANA------FKAIPIR----PSITKAYGR------VDADGSRYLLGDHAGLLHLL 228 (1036)
Q Consensus 165 ~~lip~p~~~~G~lv~~~~~i~y~~~~~------~~~~~~~----~~~~~~~~~------~~~~~~~~ll~~~~G~l~~l 228 (1036)
.+|||+|.|.||+||++++.++|.++.. ...++.+ ...+++|++ ...+++++||++++|+||++
T Consensus 158 ~~LIPlp~~~ggllV~~~~~i~y~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~~~lL~~e~G~l~~l 237 (504)
T PF10433_consen 158 SFLIPLPNPPGGLLVGGENIIIYKNHLIGSGDYSFLSIPSPPSSSSSLWTSWARPERNISYDKDGDRILLQDEDGDLYLL 237 (504)
T ss_dssp EEEEEE-TTT-SEEEEESSEEEEEE------TTEEEEE--H-HHHTS-EEEEEE------SSTTSSEEEEEETTSEEEEE
T ss_pred cEEEEcCCCCcEEEEECCEEEEEecccccccccccccccCCccCCCceEEEEEeccccceecCCCCEEEEEeCCCeEEEE
Confidence 9999999998999999999999997532 2344443 467888876 34567899999999999999
Q ss_pred EEEecCcEEeeEEEEEcCc-cccceEEEEecCC--eEEEEEeecCeeEEEEeeCCCCCCCcEEEeeecccCCceeeeEEe
Q 001655 229 VITHEKEKVTGLKIELLGE-TSIASTISYLDNA--VVYIGSSYGDSQLIKLNLQPDAKGSYVEVLERYVNLGPIVDFCVV 305 (1036)
Q Consensus 229 ~l~~~~~~v~~l~i~~~~~-~~~~s~l~~l~~~--~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~~l~n~~Pi~D~~~~ 305 (1036)
.+..+++ ++++.++|+ .++|+++++++++ +||+||++|||+++++... +++++++++|||||+||+++
T Consensus 238 ~l~~~~~---~i~i~~~g~~~~~~s~l~~l~~g~d~lf~gs~~gds~l~~~~~~------~l~~~~~~~N~~Pi~D~~v~ 308 (504)
T PF10433_consen 238 TLDNDGG---SISITYLGTLCSIASSLTYLKNGGDYLFVGSEFGDSQLLQISLS------NLEVLDSLPNWGPIVDFCVV 308 (504)
T ss_dssp EEEEEEE---EEEEEEEEE--S-ESEEEEESTT--EEEEEESSS-EEEEEEESE------SEEEEEEE----SEEEEEEE
T ss_pred EEEECCC---eEEEEEcCCcCChhheEEEEcCCCEEEEEEEecCCcEEEEEeCC------CcEEEEeccCcCCccceEEe
Confidence 9998875 789999999 8999999999999 9999999999999999853 38999999999999999999
Q ss_pred ccCCCCCc------eEEEEeeCCCCccEEEEecCCcee--EEEeeeCCCcceEEEeecCCCCCcccEEEEEecCceEEEE
Q 001655 306 DLERQGQG------QVVTCSGAYKDGSLRIVRNGIGIN--EQASVELQGIKGMWSLRSSTDDPFDTFLVVSFISETRILA 377 (1036)
Q Consensus 306 ~~~~~~~~------~lv~~sG~g~~g~l~~lr~gi~~~--~~~~~~l~~~~~iw~l~~~~~~~~~~~lv~S~~~~T~vl~ 377 (1036)
+...+++. +||+|||.|++|+|+++|+|++++ ..+..++++++++|+++....+ +.||++|++++|+||+
T Consensus 309 ~~~~~~~~~~~~~~~lv~~sG~g~~gsL~~lr~Gi~~~~~~~~~~~l~~v~~iW~l~~~~~~--~~~lv~S~~~~T~vl~ 386 (504)
T PF10433_consen 309 DSSNSGQPSNPSSDQLVACSGAGKRGSLRILRNGIGIEGLELASSELPGVTGIWTLKLSSSD--HSYLVLSFPNETRVLQ 386 (504)
T ss_dssp -TSSSSS-------EEEEEESSGGG-EEEEEEESBEEE--EEEEEEESTEEEEEEE-SSSSS--BSEEEEEESSEEEEEE
T ss_pred ccccCCCCcccccceEEEEECcCCCCcEEEEeccCCceeeeeeccCCCCceEEEEeeecCCC--ceEEEEEcCCceEEEE
Confidence 87655555 999999999999999999999999 8888999999999999875432 8999999999999999
Q ss_pred ecC---CCCeeeeeecCeeccccceeeeecCCCeEEEEecCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEc
Q 001655 378 MNL---EDELEETEIEGFCSQTQTLFCHDAIYNQLVQVTSGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATG 454 (1036)
Q Consensus 378 ~~~---~~~~~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~ 454 (1036)
++. .++++|++..+|.++++||+||+++++.+||||+++||+++.+..+...+|.+|.+..|++|++++.+++++..
T Consensus 387 ~~~~d~~e~~~e~~~~~f~~~~~Tl~~~~~~~~~ivQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~a~~~~~~v~v~~~ 466 (504)
T PF10433_consen 387 ISEGDDGEEVEEVEEDGFDTDEPTLAAGNVGDGRIVQVTPKGIRLIDLEDGKLTQEWKPPAGSIIVAASINDPQVLVALS 466 (504)
T ss_dssp ES----SSEEEEE---TS-SSS-EEEEEEETTTEEEEEESSEEEEEESSSTSEEEEEE-TTS---SEEEESSSEEEEEE-
T ss_pred EecccCCcchhhhhhccCCCCCCCeEEEEcCCCeEEEEecCeEEEEECCCCeEEEEEeCCCCCeEEEEEECCCEEEEEEe
Confidence 962 34677774459999999999999999999999999999998766678889999999999999999999999999
Q ss_pred CCeEEEEEEcCcEEEEEEe----ccCCceeEEEEcCC
Q 001655 455 GGHLVYLEIGDGILTEVKH----AQLEYEISCLDINP 487 (1036)
Q Consensus 455 ~~~~~~l~~~~~~l~~~~~----~~l~~~is~l~~~~ 487 (1036)
++.+++|+++...+..... .+++.+|+|++++|
T Consensus 467 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~eis~l~i~p 503 (504)
T PF10433_consen 467 GGELVYFELDDNKISVSDNDETILELDNEISCLSIEP 503 (504)
T ss_dssp TTEEEEEEEETTEEEEEEE----EE-SS-EEEEE---
T ss_pred CCcEEEEEEECCceeeeeeccccccCCCceEEEEeCC
Confidence 9999999998765543322 24789999999876
No 6
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=100.00 E-value=1.1e-50 Score=451.71 Aligned_cols=310 Identities=38% Similarity=0.653 Sum_probs=257.8
Q ss_pred eEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCC---CceEEEEEeeeeCCCCCCCcceEEEEEEEeC-----CeEE
Q 001655 691 MHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDD---SNVYYCVGTAYVLPEENEPTKGRILVFIVED-----GKLQ 762 (1036)
Q Consensus 691 ~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~---~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~-----~kl~ 762 (1036)
+|+|+++|+.+|+++++++|+++|+++|++.|+|..+ .++||+|||++..+++..+.+|||++|++.+ .+++
T Consensus 1 ~s~i~l~d~~~~~~~~~~~l~~~E~~~s~~~~~l~~~~~~~~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~ 80 (321)
T PF03178_consen 1 ASSIRLVDPTTFEVLDSFELEPNEHVTSLCSVKLKGDSTGKKEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLK 80 (321)
T ss_dssp --EEEEEETTTSSEEEEEEEETTEEEEEEEEEEETTS---SSEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEE
T ss_pred CcEEEEEeCCCCeEEEEEECCCCceEEEEEEEEEcCccccccCEEEEEecccccccccccCcEEEEEEEEcccccceEEE
Confidence 3789999999999999999999999999999999875 4899999999998544444559999999997 3999
Q ss_pred EEEEEEecCceeEeccccCeEEEEECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEE
Q 001655 763 LIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 763 ~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~ 842 (1036)
++++++++|||++|+.++|+|++|+|++|++|+|+.+ .+|.+.|+++.+.+++++.+.+|+|++||+++|+++++|
T Consensus 81 ~i~~~~~~g~V~ai~~~~~~lv~~~g~~l~v~~l~~~----~~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv~~~~~ 156 (321)
T PF03178_consen 81 LIHSTEVKGPVTAICSFNGRLVVAVGNKLYVYDLDNS----KTLLKKAFYDSPFYITSLSVFKNYILVGDAMKSVSLLRY 156 (321)
T ss_dssp EEEEEEESS-EEEEEEETTEEEEEETTEEEEEEEETT----SSEEEEEEE-BSSSEEEEEEETTEEEEEESSSSEEEEEE
T ss_pred EEEEEeecCcceEhhhhCCEEEEeecCEEEEEEccCc----ccchhhheecceEEEEEEeccccEEEEEEcccCEEEEEE
Confidence 9999999999999999999999999999999999632 258899999999999999999999999999999999999
Q ss_pred eccCCeEEEEeccCCcceeEEEEEe-eCceEEEEccCCcEEEEeeCCCCCCccccc-ceeEEEEEEcCCccceEEeeeee
Q 001655 843 KHEEGAIEERARDYNANWMSAVEIL-DDDIYLGAENNFNLFTVRKNSEGATDEERG-RLEVVGEYHLGEFVNRFRHGSLV 920 (1036)
Q Consensus 843 ~~~~~~l~~~a~D~~~~~~~~~~~l-~~~~~l~~D~~gnl~~l~~~~~~~~~~~~~-~L~~~~~~~lg~~v~~~~~~~l~ 920 (1036)
++++.+|.++|||+.++|+++++++ +++.++++|++||+++|+++++..++.++. +|+..++||+|+.|++++++++.
T Consensus 157 ~~~~~~l~~va~d~~~~~v~~~~~l~d~~~~i~~D~~gnl~~l~~~~~~~~~~~~~~~L~~~~~f~lg~~v~~~~~~~l~ 236 (321)
T PF03178_consen 157 DEENNKLILVARDYQPRWVTAAEFLVDEDTIIVGDKDGNLFVLRYNPEIPNSRDGDPKLERISSFHLGDIVNSFRRGSLI 236 (321)
T ss_dssp ETTTE-EEEEEEESS-BEEEEEEEE-SSSEEEEEETTSEEEEEEE-SS-SSTTTTTTBEEEEEEEE-SS-EEEEEE--SS
T ss_pred EccCCEEEEEEecCCCccEEEEEEecCCcEEEEEcCCCeEEEEEECCCCcccccccccceeEEEEECCCccceEEEEEee
Confidence 9988889999999999999999999 667899999999999999998888777788 99999999999999999999876
Q ss_pred ecCCCCCCCCcceEEEEccccceEEEEe-cChhHHHHHHHHHHHHHhcccCCCCCCcccccccccccccCCCCcEEehhH
Q 001655 921 MRLPDSDVGQIPTVIFGTVNGVIGVIAS-LPHEQYLFLEKLQTNLRKVIKGVGGLNHEQWRSFNNEKKTVDAKNFLDGDL 999 (1036)
Q Consensus 921 ~~~~~~~~~~~~~il~~t~~GsIg~l~~-l~~~~~~~L~~lq~~l~~~~~~~~gl~~~~~R~~~~~~~~~~~~~~iDGdl 999 (1036)
++..+.+....+.++|+|.+|+||.+.| +++++|++|+.||+.|.+..+++||++|++||+++++ +...+++||||||
T Consensus 237 ~~~~~~~~~~~~~i~~~T~~G~Ig~l~p~l~~~~~~~L~~lQ~~l~~~~~~~~gl~~~~~R~~~~~-~~~~~~~~iDgdl 315 (321)
T PF03178_consen 237 PRSGSSESPNRPQILYGTVDGSIGVLIPFLSEEEYRFLQALQNNLRKHIPSLGGLNPRSFRSYKNP-RMKRSKGFIDGDL 315 (321)
T ss_dssp --SSSS-TTEEEEEEEEETTS-EEEEEE-E-HHHHHHHHHHHHHHHHHS--TTS--HHHHTSEEES-EEE--BSEEEHHH
T ss_pred ecCCCCcccccceEEEEecCCEEEEEEecCCHHHHHHHHHHHHHHHhhCCCCccCChHHhccccCc-cccCCCccCcHHH
Confidence 5411222224678999999999999999 8999999999999999999999999999999999986 3333899999999
Q ss_pred HHHHhc
Q 001655 1000 IESFLD 1005 (1036)
Q Consensus 1000 l~~fl~ 1005 (1036)
|++|++
T Consensus 316 l~~fl~ 321 (321)
T PF03178_consen 316 LEQFLE 321 (321)
T ss_dssp HHGGGG
T ss_pred HHHhhC
Confidence 999985
No 7
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=98.91 E-value=2.5e-05 Score=85.49 Aligned_cols=215 Identities=16% Similarity=0.207 Sum_probs=138.2
Q ss_pred CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEe
Q 001655 638 EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGC 717 (1036)
Q Consensus 638 ~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~ 717 (1036)
++.|+.-.+....-.....++++.+|+-++-.++..+.+|+|.. .|.++...+.-..-...|+ +.
T Consensus 383 Dd~l~~~~~~~~~~t~~~~~~lg~QP~~lav~~d~~~avv~~~~-----------~iv~l~~~~~~~~~~~~y~----~s 447 (603)
T KOG0318|consen 383 DDTLRVISLKDNGYTKSEVVKLGSQPKGLAVLSDGGTAVVACIS-----------DIVLLQDQTKVSSIPIGYE----SS 447 (603)
T ss_pred CCeEEEEecccCcccccceeecCCCceeEEEcCCCCEEEEEecC-----------cEEEEecCCcceeeccccc----cc
Confidence 55565555433222223347999999999999888888888874 4666653332111112222 23
Q ss_pred EEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeE-EEEEEEEecCceeEeccc-cCeEEEE--ECCEEEE
Q 001655 718 SILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKL-QLIAEKETKGAVYSLNAF-NGKLLAA--INQKIQL 793 (1036)
Q Consensus 718 si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl-~~~~~~~~~g~v~~i~~~-~g~Lv~~--~g~~l~v 793 (1036)
|++. ...+.+++||. .-|.+++|.+.+..+ +.....+.++++++|+.- ++..+++ ...++.+
T Consensus 448 ~vAv----~~~~~~vaVGG----------~Dgkvhvysl~g~~l~ee~~~~~h~a~iT~vaySpd~~yla~~Da~rkvv~ 513 (603)
T KOG0318|consen 448 AVAV----SPDGSEVAVGG----------QDGKVHVYSLSGDELKEEAKLLEHRAAITDVAYSPDGAYLAAGDASRKVVL 513 (603)
T ss_pred eEEE----cCCCCEEEEec----------ccceEEEEEecCCcccceeeeecccCCceEEEECCCCcEEEEeccCCcEEE
Confidence 3332 12478899995 237799999987654 445667899999999966 4444444 3468889
Q ss_pred EEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEE
Q 001655 794 YKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYL 873 (1036)
Q Consensus 794 ~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l 873 (1036)
|+.+.+ ..+..+.+++...+..++-+....++..|-+-..|.++..+. |.+- ...++.++..++.+.++++.+++
T Consensus 514 yd~~s~---~~~~~~w~FHtakI~~~aWsP~n~~vATGSlDt~Viiysv~k-P~~~-i~iknAH~~gVn~v~wlde~tvv 588 (603)
T KOG0318|consen 514 YDVASR---EVKTNRWAFHTAKINCVAWSPNNKLVATGSLDTNVIIYSVKK-PAKH-IIIKNAHLGGVNSVAWLDESTVV 588 (603)
T ss_pred EEcccC---ceecceeeeeeeeEEEEEeCCCceEEEeccccceEEEEEccC-hhhh-eEeccccccCceeEEEecCceEE
Confidence 987532 224444555544443333332334666788888888776653 2222 67788889899999999999999
Q ss_pred EEccCCcEEEEee
Q 001655 874 GAENNFNLFTVRK 886 (1036)
Q Consensus 874 ~~D~~gnl~~l~~ 886 (1036)
.+-.+.|+.+...
T Consensus 589 SsG~Da~iK~W~v 601 (603)
T KOG0318|consen 589 SSGQDANIKVWNV 601 (603)
T ss_pred eccCcceeEEecc
Confidence 8888888877653
No 8
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=98.89 E-value=4.6e-05 Score=86.07 Aligned_cols=408 Identities=16% Similarity=0.149 Sum_probs=213.4
Q ss_pred CCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEeccC-CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEE
Q 001655 435 PGYSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHAQL-EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIF 511 (1036)
Q Consensus 435 ~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l-~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~ 511 (1036)
.|..|=+++++ +..+.|.+++|.+.++.+.++.++....+.- ...+-|++..+ ....++.|+- ||-|.+|
T Consensus 109 ~gg~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~r~l~rq~sRvLslsw~~------~~~~i~~Gs~-Dg~Iriw 181 (691)
T KOG2048|consen 109 NGGAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYKRSLMRQKSRVLSLSWNP------TGTKIAGGSI-DGVIRIW 181 (691)
T ss_pred CCcceeEEEeCCccceEEeecCCceEEEEecCCceEEEEeecccccceEEEEEecC------CccEEEeccc-CceEEEE
Confidence 45567667766 5688888888877777777776665433322 25677888864 2456888988 9999999
Q ss_pred ECCCCCeeEE-----ecCCC--ccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEE-
Q 001655 512 SLPDLNLITK-----EHLGG--EIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTF- 583 (1036)
Q Consensus 512 ~l~~l~~v~~-----~~l~~--~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~- 583 (1036)
+......+.. ..+.. ..+.=|+++++ ...+..|-..|.+-.+... .+.|........+. | ..+
T Consensus 182 d~~~~~t~~~~~~~~d~l~k~~~~iVWSv~~Lr---d~tI~sgDS~G~V~FWd~~--~gTLiqS~~~h~ad--V--l~La 252 (691)
T KOG2048|consen 182 DVKSGQTLHIITMQLDRLSKREPTIVWSVLFLR---DSTIASGDSAGTVTFWDSI--FGTLIQSHSCHDAD--V--LALA 252 (691)
T ss_pred EcCCCceEEEeeecccccccCCceEEEEEEEee---cCcEEEecCCceEEEEccc--Ccchhhhhhhhhcc--e--eEEE
Confidence 9987555442 12221 12223444442 4457777778877765433 34333221111110 1 111
Q ss_pred EeCCceEEEEEcCCceEE-EecCCc---EE---EeeeccccceeeecccCCCCCCeEEEE--eCCeEEEEEEcCCCCe-E
Q 001655 584 SSKNTTHVFAASDRPTVI-YSSNKK---LL---YSNVNLKEVSHMCPFNSAAFPDSLAIA--KEGELTIGTIDDIQKL-H 653 (1036)
Q Consensus 584 ~~~~~~~v~~~~~~p~~i-~~~~~~---~~---~~~~~~~~i~~~~~f~~~~~~~~l~~~--~~~~l~i~~l~~~~~~-~ 653 (1036)
-.++++.+|+.|-.|-++ |...++ .. ....+...+.+++.+.+ +++. .+..|.++........ +
T Consensus 253 v~~~~d~vfsaGvd~~ii~~~~~~~~~~wv~~~~r~~h~hdvrs~av~~~------~l~sgG~d~~l~i~~s~~~~~~~h 326 (691)
T KOG2048|consen 253 VADNEDRVFSAGVDPKIIQYSLTTNKSEWVINSRRDLHAHDVRSMAVIEN------ALISGGRDFTLAICSSREFKNMDH 326 (691)
T ss_pred EcCCCCeEEEccCCCceEEEEecCCccceeeeccccCCcccceeeeeecc------eEEecceeeEEEEccccccCchhh
Confidence 123457888888555444 443222 11 11222345667776643 2332 2445566655543222 2
Q ss_pred EEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceee-EEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEE
Q 001655 654 IRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEM-HFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYY 732 (1036)
Q Consensus 654 ~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~-~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i 732 (1036)
.++.+....+ ++.-.++.++++ .-... ..+.|+ ++.-.=-...+.-+..+..++.|.+.|.+.. ...+.|
T Consensus 327 ~~~~~~p~~~-~v~~a~~~~L~~-~w~~h---~v~lwrlGS~~~~g~~~~~~Llkl~~k~~~nIs~~aiS----Pdg~~I 397 (691)
T KOG2048|consen 327 RQKNLFPASD-RVSVAPENRLLV-LWKAH---GVDLWRLGSVILQGEYNYIHLLKLFTKEKENISCAAIS----PDGNLI 397 (691)
T ss_pred hccccccccc-eeecCccceEEE-Eeccc---cccceeccCcccccccChhhheeeecCCccceeeeccC----CCCCEE
Confidence 2222222221 122222222222 21111 000010 1110000123344556777888888776553 236899
Q ss_pred EEEeeeeCCCCCCCcceEEEEEEEe-CCeEEEEEEEEec---CceeEeccc--cCeEEEEECCEEEEEEeeecCCCccch
Q 001655 733 CVGTAYVLPEENEPTKGRILVFIVE-DGKLQLIAEKETK---GAVYSLNAF--NGKLLAAINQKIQLYKWMLRDDGTREL 806 (1036)
Q Consensus 733 ~VGT~~~~~~e~~~~~Gri~v~~i~-~~kl~~~~~~~~~---g~v~~i~~~--~g~Lv~~~g~~l~v~~~~~~~~~~~~L 806 (1036)
++||.. |+.+|++. .+++++....+.+ -++.++.-. +++++++..+...+..++......+++
T Consensus 398 a~st~~-----------~~~iy~L~~~~~vk~~~v~~~~~~~~~a~~i~ftid~~k~~~~s~~~~~le~~el~~ps~kel 466 (691)
T KOG2048|consen 398 AISTVS-----------RTKIYRLQPDPNVKVINVDDVPLALLDASAISFTIDKNKLFLVSKNIFSLEEFELETPSFKEL 466 (691)
T ss_pred EEeecc-----------ceEEEEeccCcceeEEEeccchhhhccceeeEEEecCceEEEEecccceeEEEEecCcchhhh
Confidence 999963 44556555 2233333322221 123333322 456655554444444443333344666
Q ss_pred hcccccccceEE--EEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEe--eCceEEEEccCCcEE
Q 001655 807 QSECGHHGHILA--LYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEIL--DDDIYLGAENNFNLF 882 (1036)
Q Consensus 807 ~~~~~~~~~~~~--~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l--~~~~~l~~D~~gnl~ 882 (1036)
...........+ +-...+||+|.|.+....+.++ +-+..+..++.-+.. ..+|++.+- +.+++++++.++.++
T Consensus 467 ~~~~~~~~~~~I~~l~~SsdG~yiaa~~t~g~I~v~--nl~~~~~~~l~~rln-~~vTa~~~~~~~~~~lvvats~nQv~ 543 (691)
T KOG2048|consen 467 KSIQSQAKCPSISRLVVSSDGNYIAAISTRGQIFVY--NLETLESHLLKVRLN-IDVTAAAFSPFVRNRLVVATSNNQVF 543 (691)
T ss_pred hccccccCCCcceeEEEcCCCCEEEEEeccceEEEE--EcccceeecchhccC-cceeeeeccccccCcEEEEecCCeEE
Confidence 554332111222 2345689999999977777654 556666677775555 788888776 345799999999999
Q ss_pred EEeeC
Q 001655 883 TVRKN 887 (1036)
Q Consensus 883 ~l~~~ 887 (1036)
-|..+
T Consensus 544 efdi~ 548 (691)
T KOG2048|consen 544 EFDIE 548 (691)
T ss_pred EEecc
Confidence 99884
No 9
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=98.13 E-value=0.00055 Score=70.70 Aligned_cols=257 Identities=20% Similarity=0.255 Sum_probs=149.4
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
..||.+.+++ .+..++|++| ||++.+|+.+..++....... . -++-+.+.+....+.|.-||.+..|.
T Consensus 14 d~IS~v~f~~------~~~~LLvssW-DgslrlYdv~~~~l~~~~~~~--~---plL~c~F~d~~~~~~G~~dg~vr~~D 81 (323)
T KOG1036|consen 14 DGISSVKFSP------SSSDLLVSSW-DGSLRLYDVPANSLKLKFKHG--A---PLLDCAFADESTIVTGGLDGQVRRYD 81 (323)
T ss_pred hceeeEEEcC------cCCcEEEEec-cCcEEEEeccchhhhhheecC--C---ceeeeeccCCceEEEeccCceEEEEE
Confidence 4578888864 2578999999 999999999875432211111 1 12223455567899999999999999
Q ss_pred EecCCCccccceeeecCc--cceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeec----------cccceeeeccc
Q 001655 558 LNMKTGELTDRKKVSLGT--QPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVN----------LKEVSHMCPFN 625 (1036)
Q Consensus 558 ~~~~~~~l~~~~~~~lG~--~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~----------~~~i~~~~~f~ 625 (1036)
+...+ ..++|+ .|++..... -..+.+++|. .++++.+.... .+.+.++.
T Consensus 82 ln~~~-------~~~igth~~~i~ci~~~--~~~~~vIsgs-------WD~~ik~wD~R~~~~~~~~d~~kkVy~~~--- 142 (323)
T KOG1036|consen 82 LNTGN-------EDQIGTHDEGIRCIEYS--YEVGCVISGS-------WDKTIKFWDPRNKVVVGTFDQGKKVYCMD--- 142 (323)
T ss_pred ecCCc-------ceeeccCCCceEEEEee--ccCCeEEEcc-------cCccEEEEeccccccccccccCceEEEEe---
Confidence 87543 233443 455433221 1223334332 12223222111 11121111
Q ss_pred CCCCCCeEEE-EeCCeEEEEEEcCCC-CeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCC--
Q 001655 626 SAAFPDSLAI-AKEGELTIGTIDDIQ-KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQT-- 701 (1036)
Q Consensus 626 ~~~~~~~l~~-~~~~~l~i~~l~~~~-~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t-- 701 (1036)
-..+.|+. ..+.++.+..|.... .+..|.-++.+..|.|+..|+..-|++.+.+ .+-.++++|+..
T Consensus 143 --v~g~~LvVg~~~r~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSie--------GRVavE~~d~s~~~ 212 (323)
T KOG1036|consen 143 --VSGNRLVVGTSDRKVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGEGYVVSSIE--------GRVAVEYFDDSEEA 212 (323)
T ss_pred --ccCCEEEEeecCceEEEEEcccccchhhhccccceeEEEEEEEecCCCceEEEeec--------ceEEEEccCCchHH
Confidence 12344555 557777778777664 3455666788888999999988888888874 344667776641
Q ss_pred ------ceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeC-CeEEEEEEEEecCcee
Q 001655 702 ------FEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVED-GKLQLIAEKETKGAVY 774 (1036)
Q Consensus 702 ------~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~-~kl~~~~~~~~~g~v~ 774 (1036)
|+.. +..-+..|.+..+..+.|.. .+..++-|. .-|.+.+|+..+ ++|+.+++.+..=+..
T Consensus 213 ~skkyaFkCH-r~~~~~~~~~yPVNai~Fhp-~~~tfaTgG----------sDG~V~~Wd~~~rKrl~q~~~~~~SI~sl 280 (323)
T KOG1036|consen 213 QSKKYAFKCH-RLSEKDTEIIYPVNAIAFHP-IHGTFATGG----------SDGIVNIWDLFNRKRLKQLAKYETSISSL 280 (323)
T ss_pred hhhceeEEee-ecccCCceEEEEeceeEecc-ccceEEecC----------CCceEEEccCcchhhhhhccCCCCceEEE
Confidence 1111 11225557788888887753 234455443 459999998884 4688888764333333
Q ss_pred EeccccCeEEEEE
Q 001655 775 SLNAFNGKLLAAI 787 (1036)
Q Consensus 775 ~i~~~~g~Lv~~~ 787 (1036)
+.+.-...|.+|.
T Consensus 281 sfs~dG~~LAia~ 293 (323)
T KOG1036|consen 281 SFSMDGSLLAIAS 293 (323)
T ss_pred EeccCCCeEEEEe
Confidence 4333333555554
No 10
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=98.04 E-value=0.054 Score=62.83 Aligned_cols=445 Identities=15% Similarity=0.113 Sum_probs=224.6
Q ss_pred ecCCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEecCCeEEEEEeecCeeEEEEeeCCC-CCCCcEE
Q 001655 210 DADGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQPD-AKGSYVE 288 (1036)
Q Consensus 210 ~~~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~~~-~~~~~~~ 288 (1036)
.+++..++..||.|+..++.+.. ...+.++.-.....|+..-.||-+|+.+....-++++.+..-. +-.. +.
T Consensus 64 Sp~g~lllavdE~g~~~lvs~~~------r~Vlh~f~fk~~v~~i~fSPng~~fav~~gn~lqiw~~P~~~~~~~~p-Fv 136 (893)
T KOG0291|consen 64 SPDGTLLLAVDERGRALLVSLLS------RSVLHRFNFKRGVGAIKFSPNGKFFAVGCGNLLQIWHAPGEIKNEFNP-FV 136 (893)
T ss_pred CCCceEEEEEcCCCcEEEEeccc------ceeeEEEeecCccceEEECCCCcEEEEEecceeEEEecCcchhcccCc-ce
Confidence 34666888899999999998853 2233333223456788888899999887666667776654321 1112 21
Q ss_pred EeeecccCCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEe---------------------cCCceeEEEeeeCCCc
Q 001655 289 VLERYVNLGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVR---------------------NGIGINEQASVELQGI 347 (1036)
Q Consensus 289 ~~~~l~n~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr---------------------~gi~~~~~~~~~l~~~ 347 (1036)
.. =.+.|+--|++-++-. ...++++..+....-.|--++ -|..-..+....-.|.
T Consensus 137 l~--r~~~g~fddi~si~Ws--~DSr~l~~gsrD~s~rl~~v~~~k~~~~~~l~gHkd~VvacfF~~~~~~l~tvskdG~ 212 (893)
T KOG0291|consen 137 LH--RTYLGHFDDITSIDWS--DDSRLLVTGSRDLSARLFGVDGNKNLFTYALNGHKDYVVACFFGANSLDLYTVSKDGA 212 (893)
T ss_pred Ee--eeecCCccceeEEEec--cCCceEEeccccceEEEEEeccccccceEeccCCCcceEEEEeccCcceEEEEecCce
Confidence 11 2345566566554421 112222222211111111111 1111111111222344
Q ss_pred ceEEEeecCCCCCcccEEEEEecCceEEEEecCCCCeee---------eeecCeeccccceeeeecCCC--eEEEEecCc
Q 001655 348 KGMWSLRSSTDDPFDTFLVVSFISETRILAMNLEDELEE---------TEIEGFCSQTQTLFCHDAIYN--QLVQVTSGS 416 (1036)
Q Consensus 348 ~~iw~l~~~~~~~~~~~lv~S~~~~T~vl~~~~~~~~~e---------~~~~~f~~~~~Tl~~~~~~~~--~~vQVt~~~ 416 (1036)
--+|+....+...... =--....+.. ...+ +-|| .....|.-+..-+.|+.+..+ .++--..++
T Consensus 213 l~~W~~~~~P~~~~~~--~kd~eg~~d~-~~~~--~~Eek~~~~~~~k~~k~~ln~~~~kvtaa~fH~~t~~lvvgFssG 287 (893)
T KOG0291|consen 213 LFVWTCDLRPPELDKA--EKDEEGSDDE-EMDE--DGEEKTHKIFWYKTKKHYLNQNSSKVTAAAFHKGTNLLVVGFSSG 287 (893)
T ss_pred EEEEEecCCCcccccc--cccccccccc-cccc--cchhhhcceEEEEEEeeeecccccceeeeeccCCceEEEEEecCC
Confidence 4445443211000000 0000000000 0000 0111 011222223344555555333 333334555
Q ss_pred EE-EEecCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcC-CeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCC
Q 001655 417 VR-LVSSTSRELRNEWKSPPGYSVNVATAN--ASQVLLATGG-GHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENP 492 (1036)
Q Consensus 417 i~-l~~~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~-~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~ 492 (1036)
+. ++.......++.... ...+|..++.| ++++.+..+. |.++..+-..... ..+..--...++|++.+|
T Consensus 288 ~f~LyelP~f~lih~LSi-s~~~I~t~~~N~tGDWiA~g~~klgQLlVweWqsEsY-VlKQQgH~~~i~~l~YSp----- 360 (893)
T KOG0291|consen 288 EFGLYELPDFNLIHSLSI-SDQKILTVSFNSTGDWIAFGCSKLGQLLVWEWQSESY-VLKQQGHSDRITSLAYSP----- 360 (893)
T ss_pred eeEEEecCCceEEEEeec-ccceeeEEEecccCCEEEEcCCccceEEEEEeeccce-eeeccccccceeeEEECC-----
Confidence 54 555544445555433 34689999988 9999998754 3444445533221 112122235689999865
Q ss_pred CcccEEEEEEecCCEEEEEECCC-CCee-EEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCcccccee
Q 001655 493 SYSQIAAVGMWTDISVRIFSLPD-LNLI-TKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKK 570 (1036)
Q Consensus 493 ~~~~~~~vg~w~~~~i~i~~l~~-l~~v-~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~ 570 (1036)
.+.+++-|.. ||.+.||+... +..+ +.++-+ ....+.+.. .+..|+...-||.+-.+.+..- ++- +
T Consensus 361 -Dgq~iaTG~e-DgKVKvWn~~SgfC~vTFteHts---~Vt~v~f~~--~g~~llssSLDGtVRAwDlkRY----rNf-R 428 (893)
T KOG0291|consen 361 -DGQLIATGAE-DGKVKVWNTQSGFCFVTFTEHTS---GVTAVQFTA--RGNVLLSSSLDGTVRAWDLKRY----RNF-R 428 (893)
T ss_pred -CCcEEEeccC-CCcEEEEeccCceEEEEeccCCC---ceEEEEEEe--cCCEEEEeecCCeEEeeeeccc----cee-e
Confidence 3678888888 99999999754 3433 233332 122222232 3466888888999988876531 111 1
Q ss_pred eecCccceEEEEEEeCCceEEEEEcCCc-eEEE-ec--CCcE-EEeeeccccceeeecccCCCCCCeEEEEe-CCeEEEE
Q 001655 571 VSLGTQPITLRTFSSKNTTHVFAASDRP-TVIY-SS--NKKL-LYSNVNLKEVSHMCPFNSAAFPDSLAIAK-EGELTIG 644 (1036)
Q Consensus 571 ~~lG~~pv~l~~~~~~~~~~v~~~~~~p-~~i~-~~--~~~~-~~~~~~~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~ 644 (1036)
.+-++.|+++..+..+...-+.+.|+.- +=|+ ++ .|++ .+..=+..++.+++ |+. ..+.|+..+ ++.+++=
T Consensus 429 Tft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~-f~~--~~~~LaS~SWDkTVRiW 505 (893)
T KOG0291|consen 429 TFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLS-FSP--DGSLLASGSWDKTVRIW 505 (893)
T ss_pred eecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeE-Ecc--ccCeEEeccccceEEEE
Confidence 2356788888776544223355555443 3333 22 3443 23233345554422 221 112333334 6777776
Q ss_pred EEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCce
Q 001655 645 TIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFE 703 (1036)
Q Consensus 645 ~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~ 703 (1036)
.+-.... .+..+++......+.+.|+.+-++|++.+ +.|-++|.+...
T Consensus 506 ~if~s~~-~vEtl~i~sdvl~vsfrPdG~elaVaTld----------gqItf~d~~~~~ 553 (893)
T KOG0291|consen 506 DIFSSSG-TVETLEIRSDVLAVSFRPDGKELAVATLD----------GQITFFDIKEAV 553 (893)
T ss_pred EeeccCc-eeeeEeeccceeEEEEcCCCCeEEEEEec----------ceEEEEEhhhce
Confidence 6644322 45677777888889999999999999986 356666665443
No 11
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=98.04 E-value=0.019 Score=64.42 Aligned_cols=185 Identities=13% Similarity=0.122 Sum_probs=102.7
Q ss_pred CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEE-----EEECCCCCeEeEEEEEEEcCCCceEEEE
Q 001655 660 GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIS-----TYPLDTFEYGCSILSCSFSDDSNVYYCV 734 (1036)
Q Consensus 660 ~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~-----~~~~~~~E~v~si~~~~l~~~~~~~i~V 734 (1036)
...|+.++++|+.+.+.|..... ..|.++|..+...+. ....+.++.+..+ .+..+ .+++.|
T Consensus 125 ~~~~~~~~~~p~g~~l~v~~~~~---------~~v~v~d~~~~g~l~~~~~~~~~~~~g~~p~~~---~~~pd-g~~lyv 191 (330)
T PRK11028 125 LEGCHSANIDPDNRTLWVPCLKE---------DRIRLFTLSDDGHLVAQEPAEVTTVEGAGPRHM---VFHPN-QQYAYC 191 (330)
T ss_pred CCcccEeEeCCCCCEEEEeeCCC---------CEEEEEEECCCCcccccCCCceecCCCCCCceE---EECCC-CCEEEE
Confidence 35688888999888777766432 468888765533221 2344555555443 34433 445555
Q ss_pred EeeeeCCCCCCCcceEEEEEEEeC--CeEEEEEEEEe-----cCcee--E--eccccCeEEEEEC--CEEEEEEeeecCC
Q 001655 735 GTAYVLPEENEPTKGRILVFIVED--GKLQLIAEKET-----KGAVY--S--LNAFNGKLLAAIN--QKIQLYKWMLRDD 801 (1036)
Q Consensus 735 GT~~~~~~e~~~~~Gri~v~~i~~--~kl~~~~~~~~-----~g~v~--~--i~~~~g~Lv~~~g--~~l~v~~~~~~~~ 801 (1036)
... ..+.|.+|++.. ++++.+.+... .++-. + +.+=+.+|+++.. +.|.+|+++.. .
T Consensus 192 ~~~---------~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~i~~~pdg~~lyv~~~~~~~I~v~~i~~~-~ 261 (330)
T PRK11028 192 VNE---------LNSSVDVWQLKDPHGEIECVQTLDMMPADFSDTRWAADIHITPDGRHLYACDRTASLISVFSVSED-G 261 (330)
T ss_pred Eec---------CCCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCccceeEEECCCCCEEEEecCCCCeEEEEEEeCC-C
Confidence 542 358999999983 46766554432 22222 2 2232346777643 68889888532 1
Q ss_pred CccchhcccccccceEEEEEEEeCCEEEEEec-cccEEEEEEeccCCeEEEEeccCCcceeEEEEEe
Q 001655 802 GTRELQSECGHHGHILALYVQTRGDFIVVGDL-MKSISLLIYKHEEGAIEERARDYNANWMSAVEIL 867 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~-~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l 867 (1036)
+..++.........+..+.++..|.+++|+.. ...+.+++.+.+.+.+..+++=....+..++.+|
T Consensus 262 ~~~~~~~~~~~~~~p~~~~~~~dg~~l~va~~~~~~v~v~~~~~~~g~l~~~~~~~~g~~P~~~~~~ 328 (330)
T PRK11028 262 SVLSFEGHQPTETQPRGFNIDHSGKYLIAAGQKSHHISVYEIDGETGLLTELGRYAVGQGPMWVSVL 328 (330)
T ss_pred CeEEEeEEEeccccCCceEECCCCCEEEEEEccCCcEEEEEEcCCCCcEEEccccccCCCceEEEEE
Confidence 22233222111111123445556889999876 4568888877666777666543333444444443
No 12
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=98.03 E-value=0.022 Score=65.86 Aligned_cols=359 Identities=16% Similarity=0.149 Sum_probs=193.2
Q ss_pred CcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECC
Q 001655 437 YSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLP 514 (1036)
Q Consensus 437 ~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~ 514 (1036)
..|++-++. +..++.+..+..+-.++++.+++...=+..-+..+--+++.+ .+..++.|-- ++.+.+|++.
T Consensus 63 d~ita~~l~~d~~~L~~a~rs~llrv~~L~tgk~irswKa~He~Pvi~ma~~~------~g~LlAtgga-D~~v~VWdi~ 135 (775)
T KOG0319|consen 63 DEITALALTPDEEVLVTASRSQLLRVWSLPTGKLIRSWKAIHEAPVITMAFDP------TGTLLATGGA-DGRVKVWDIK 135 (775)
T ss_pred hhhheeeecCCccEEEEeeccceEEEEEcccchHhHhHhhccCCCeEEEEEcC------CCceEEeccc-cceEEEEEee
Confidence 467776655 334444444555555566655433221122244555667754 2456777766 9999999997
Q ss_pred CCCeeEE-ecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccc-----cceeeecCccceEEEEEEeCCc
Q 001655 515 DLNLITK-EHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELT-----DRKKVSLGTQPITLRTFSSKNT 588 (1036)
Q Consensus 515 ~l~~v~~-~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~-----~~~~~~lG~~pv~l~~~~~~~~ 588 (1036)
.-...+. ...+ .+..++++.+...+..|..|-.||.+..|.+......+. ......|+ +.. +.
T Consensus 136 ~~~~th~fkG~g--GvVssl~F~~~~~~~lL~sg~~D~~v~vwnl~~~~tcl~~~~~H~S~vtsL~--------~~~-d~ 204 (775)
T KOG0319|consen 136 NGYCTHSFKGHG--GVVSSLLFHPHWNRWLLASGATDGTVRVWNLNDKRTCLHTMILHKSAVTSLA--------FSE-DS 204 (775)
T ss_pred CCEEEEEecCCC--ceEEEEEeCCccchhheeecCCCceEEEEEcccCchHHHHHHhhhhheeeee--------ecc-CC
Confidence 6443322 2223 355666665544455578899999999999874321110 01111221 111 12
Q ss_pred eEEEEEcCCceEEEec---CCcEEEeeeccccceeeecccCCCCC-CeEEEEeCCeEEEEEEcCCC--CeEEEEEeCCCc
Q 001655 589 THVFAASDRPTVIYSS---NKKLLYSNVNLKEVSHMCPFNSAAFP-DSLAIAKEGELTIGTIDDIQ--KLHIRSIPLGEH 662 (1036)
Q Consensus 589 ~~v~~~~~~p~~i~~~---~~~~~~~~~~~~~i~~~~~f~~~~~~-~~l~~~~~~~l~i~~l~~~~--~~~~~~i~l~~t 662 (1036)
..++..|.--.++.++ ...+...|+. +.+.++.-.+.+.-. ..++++.++.=.+...+... -.-.++.+-++.
T Consensus 205 ~~~ls~~RDkvi~vwd~~~~~~l~~lp~y-e~~E~vv~l~~~~~~~~~~~~TaG~~g~~~~~d~es~~~~~~~~~~~~~e 283 (775)
T KOG0319|consen 205 LELLSVGRDKVIIVWDLVQYKKLKTLPLY-ESLESVVRLREELGGKGEYIITAGGSGVVQYWDSESGKCVYKQRQSDSEE 283 (775)
T ss_pred ceEEEeccCcEEEEeehhhhhhhheechh-hheeeEEEechhcCCcceEEEEecCCceEEEEecccchhhhhhccCCchh
Confidence 2344444333333332 1223444544 445555555442211 23555555555555555432 112233332444
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCC
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPE 742 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~ 742 (1036)
..+.++.+..+-++.++.+. .+.|+|..+.+....+ ..-+|++..|+.| .+..++++|.|.
T Consensus 284 ~~~~~~~~~~~~~l~vtaeQ----------nl~l~d~~~l~i~k~i-vG~ndEI~Dm~~l---G~e~~~laVATN----- 344 (775)
T KOG0319|consen 284 IDHLLAIESMSQLLLVTAEQ----------NLFLYDEDELTIVKQI-VGYNDEILDMKFL---GPEESHLAVATN----- 344 (775)
T ss_pred hhcceeccccCceEEEEccc----------eEEEEEccccEEehhh-cCCchhheeeeec---CCccceEEEEeC-----
Confidence 67788888888888888764 6888888877665443 3456777888766 344689999994
Q ss_pred CCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEEC--CEEEEEEeeecCCCccchhcccccccc---e
Q 001655 743 ENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAIN--QKIQLYKWMLRDDGTRELQSECGHHGH---I 816 (1036)
Q Consensus 743 e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~~~~~~~~---~ 816 (1036)
++++.+|+...-..+++. -+...|.++..+ .|-|+++.+ +++.+++++ ++..+....+...++ +
T Consensus 345 -----s~~lr~y~~~~~~c~ii~--GH~e~vlSL~~~~~g~llat~sKD~svilWr~~---~~~~~~~~~a~~~gH~~sv 414 (775)
T KOG0319|consen 345 -----SPELRLYTLPTSYCQIIP--GHTEAVLSLDVWSSGDLLATGSKDKSVILWRLN---NNCSKSLCVAQANGHTNSV 414 (775)
T ss_pred -----CCceEEEecCCCceEEEe--CchhheeeeeecccCcEEEEecCCceEEEEEec---CCcchhhhhhhhccccccc
Confidence 456777765544444333 456688888855 454665555 578888873 233333333323333 2
Q ss_pred EEEEEEEeC-CEEEEEeccccEEEEEEe
Q 001655 817 LALYVQTRG-DFIVVGDLMKSISLLIYK 843 (1036)
Q Consensus 817 ~~~~l~~~~-~~I~vgD~~~Sv~~~~~~ 843 (1036)
.++.+..-+ .+.+.+---..+.+..+.
T Consensus 415 gava~~~~~asffvsvS~D~tlK~W~l~ 442 (775)
T KOG0319|consen 415 GAVAGSKLGASFFVSVSQDCTLKLWDLP 442 (775)
T ss_pred ceeeecccCccEEEEecCCceEEEecCC
Confidence 344443333 244444444555555443
No 13
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.87 E-value=0.041 Score=62.02 Aligned_cols=274 Identities=18% Similarity=0.212 Sum_probs=152.8
Q ss_pred EEEEEecC---CEEEEEECCC--CCeeEEecCCCccCceeEEeeeecCeEEEEEEeC----CCcEEEEEEecCCCccccc
Q 001655 498 AAVGMWTD---ISVRIFSLPD--LNLITKEHLGGEIIPRSVLLCAFEGISYLLCALG----DGHLLNFLLNMKTGELTDR 568 (1036)
Q Consensus 498 ~~vg~w~~---~~i~i~~l~~--l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~----~G~l~~y~~~~~~~~l~~~ 568 (1036)
++||+|.+ +.|..|++++ -++...+.......|.-+.+.+ ++.+|++... +|.+..|.++..++.|+..
T Consensus 2 ~~vgsy~~~~~~gI~~~~~d~~~g~l~~~~~~~~~~~Ps~l~~~~--~~~~LY~~~e~~~~~g~v~~~~i~~~~g~L~~~ 79 (345)
T PF10282_consen 2 LYVGSYTNGKGGGIYVFRFDEETGTLTLVQTVAEGENPSWLAVSP--DGRRLYVVNEGSGDSGGVSSYRIDPDTGTLTLL 79 (345)
T ss_dssp EEEEECCSSSSTEEEEEEEETTTTEEEEEEEEEESSSECCEEE-T--TSSEEEEEETTSSTTTEEEEEEEETTTTEEEEE
T ss_pred EEEEcCCCCCCCcEEEEEEcCCCCCceEeeeecCCCCCceEEEEe--CCCEEEEEEccccCCCCEEEEEECCCcceeEEe
Confidence 67899954 7899999932 2221111121123455555432 4567777766 6899999999877777765
Q ss_pred eeee-cCccceEEEEEEeCCceEEEEEc--CCceEEE-ec-CCcEEEee-ec-c---------ccc--eeeecccCCCCC
Q 001655 569 KKVS-LGTQPITLRTFSSKNTTHVFAAS--DRPTVIY-SS-NKKLLYSN-VN-L---------KEV--SHMCPFNSAAFP 630 (1036)
Q Consensus 569 ~~~~-lG~~pv~l~~~~~~~~~~v~~~~--~~p~~i~-~~-~~~~~~~~-~~-~---------~~i--~~~~~f~~~~~~ 630 (1036)
.+.. .|..|+.+.. ..+...++++. +....++ .+ ++++.-.. +. . +.- -+...| .|
T Consensus 80 ~~~~~~g~~p~~i~~--~~~g~~l~vany~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~----~p 153 (345)
T PF10282_consen 80 NSVPSGGSSPCHIAV--DPDGRFLYVANYGGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVF----SP 153 (345)
T ss_dssp EEEEESSSCEEEEEE--CTTSSEEEEEETTTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-----T
T ss_pred eeeccCCCCcEEEEE--ecCCCEEEEEEccCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEE----CC
Confidence 5554 6888876643 23445666653 2222222 22 34442110 00 0 000 011111 23
Q ss_pred C-eEEEE-e--CCeEEEEEEcCCC-Ce---EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC---
Q 001655 631 D-SLAIA-K--EGELTIGTIDDIQ-KL---HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD--- 699 (1036)
Q Consensus 631 ~-~l~~~-~--~~~l~i~~l~~~~-~~---~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~--- 699 (1036)
+ .++++ + .+.+.+..++... ++ ..-+++.|.-||+++++|+.+.+.|++... +.|..++.
T Consensus 154 dg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~~f~pdg~~~Yv~~e~s---------~~v~v~~~~~~ 224 (345)
T PF10282_consen 154 DGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHLAFSPDGKYAYVVNELS---------NTVSVFDYDPS 224 (345)
T ss_dssp TSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEEECSTTSSEEEEEE-TTSSEEEEEETTT---------TEEEEEEEETT
T ss_pred CCCEEEEEecCCCEEEEEEEeCCCceEEEeeccccccCCCCcEEEEcCCcCEEEEecCCC---------CcEEEEeeccc
Confidence 3 24444 3 6889999998765 23 334678889999999999988666665321 23333332
Q ss_pred -CCceEEEEEECC-CCCeE-eEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe--CCeEEEEEEEEecCc-e
Q 001655 700 -QTFEFISTYPLD-TFEYG-CSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE--DGKLQLIAEKETKGA-V 773 (1036)
Q Consensus 700 -~t~~~i~~~~~~-~~E~v-~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~--~~kl~~~~~~~~~g~-v 773 (1036)
..++.+.....- .+-.. .....+.+..+ .+++.|... ....|.+|+++ .++|+.+......|. +
T Consensus 225 ~g~~~~~~~~~~~~~~~~~~~~~~~i~ispd-g~~lyvsnr---------~~~sI~vf~~d~~~g~l~~~~~~~~~G~~P 294 (345)
T PF10282_consen 225 DGSLTEIQTISTLPEGFTGENAPAEIAISPD-GRFLYVSNR---------GSNSISVFDLDPATGTLTLVQTVPTGGKFP 294 (345)
T ss_dssp TTEEEEEEEEESCETTSCSSSSEEEEEE-TT-SSEEEEEEC---------TTTEEEEEEECTTTTTEEEEEEEEESSSSE
T ss_pred CCceeEEEEeeeccccccccCCceeEEEecC-CCEEEEEec---------cCCEEEEEEEecCCCceEEEEEEeCCCCCc
Confidence 234445544422 11110 12233445443 456666542 25689999995 468999888888776 7
Q ss_pred eEecc--ccCeEEEEEC--CEEEEEEeee
Q 001655 774 YSLNA--FNGKLLAAIN--QKIQLYKWML 798 (1036)
Q Consensus 774 ~~i~~--~~g~Lv~~~g--~~l~v~~~~~ 798 (1036)
..+.. -+.+|+++.. +.|.+|+++.
T Consensus 295 r~~~~s~~g~~l~Va~~~s~~v~vf~~d~ 323 (345)
T PF10282_consen 295 RHFAFSPDGRYLYVANQDSNTVSVFDIDP 323 (345)
T ss_dssp EEEEE-TTSSEEEEEETTTTEEEEEEEET
T ss_pred cEEEEeCCCCEEEEEecCCCeEEEEEEeC
Confidence 77764 3446777654 5899999853
No 14
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=97.83 E-value=0.043 Score=58.94 Aligned_cols=272 Identities=17% Similarity=0.181 Sum_probs=141.4
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
...|+|+++.+ ...+++++.. +|.+.+|++.+.+........ .....++.+.+ ...+++++..+|.+..|
T Consensus 9 ~~~i~~~~~~~------~~~~l~~~~~-~g~i~i~~~~~~~~~~~~~~~-~~~i~~~~~~~--~~~~l~~~~~~~~i~i~ 78 (289)
T cd00200 9 TGGVTCVAFSP------DGKLLATGSG-DGTIKVWDLETGELLRTLKGH-TGPVRDVAASA--DGTYLASGSSDKTIRLW 78 (289)
T ss_pred CCCEEEEEEcC------CCCEEEEeec-CcEEEEEEeeCCCcEEEEecC-CcceeEEEECC--CCCEEEEEcCCCeEEEE
Confidence 35688998864 2568888887 999999999875543322111 11112333332 33578888899999999
Q ss_pred EEecCCCccccceeeecCccceEEEEEEeCCceEEEEEc-CCceEEEecC-CcEEE-eeeccccceeeecccCCCCCCeE
Q 001655 557 LLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAAS-DRPTVIYSSN-KKLLY-SNVNLKEVSHMCPFNSAAFPDSL 633 (1036)
Q Consensus 557 ~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~-~~p~~i~~~~-~~~~~-~~~~~~~i~~~~~f~~~~~~~~l 633 (1036)
.+.... ..........++.-..+. .....+++.+ +....++..+ ++... .......+.+++ |+.. ...+
T Consensus 79 ~~~~~~----~~~~~~~~~~~i~~~~~~-~~~~~~~~~~~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~-~~~~--~~~l 150 (289)
T cd00200 79 DLETGE----CVRTLTGHTSYVSSVAFS-PDGRILSSSSRDKTIKVWDVETGKCLTTLRGHTDWVNSVA-FSPD--GTFV 150 (289)
T ss_pred EcCccc----ceEEEeccCCcEEEEEEc-CCCCEEEEecCCCeEEEEECCCcEEEEEeccCCCcEEEEE-EcCc--CCEE
Confidence 876421 111111111122211221 1222333333 3333333322 22211 111112233322 2211 2344
Q ss_pred EEEe-CCeEEEEEEcCCCCeEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 634 AIAK-EGELTIGTIDDIQKLHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 634 ~~~~-~~~l~i~~l~~~~~~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
+..+ ++.+.+..+..... .+.+... ..+..+.++++.+.+++++.. +.++++|..+++.+..+.-.
T Consensus 151 ~~~~~~~~i~i~d~~~~~~--~~~~~~~~~~i~~~~~~~~~~~l~~~~~~----------~~i~i~d~~~~~~~~~~~~~ 218 (289)
T cd00200 151 ASSSQDGTIKLWDLRTGKC--VATLTGHTGEVNSVAFSPDGEKLLSSSSD----------GTIKLWDLSTGKCLGTLRGH 218 (289)
T ss_pred EEEcCCCcEEEEEcccccc--ceeEecCccccceEEECCCcCEEEEecCC----------CcEEEEECCCCceecchhhc
Confidence 4445 78888887764332 2333333 367888999988777776642 47899998877766655322
Q ss_pred CCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc-CeEEEEEC--
Q 001655 712 TFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN-GKLLAAIN-- 788 (1036)
Q Consensus 712 ~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~-g~Lv~~~g-- 788 (1036)
...+.++ .+..+ ..+++.|. ..|++++|++..++...... ...+++++++-.. +.++++.+
T Consensus 219 -~~~i~~~---~~~~~-~~~~~~~~----------~~~~i~i~~~~~~~~~~~~~-~~~~~i~~~~~~~~~~~l~~~~~d 282 (289)
T cd00200 219 -ENGVNSV---AFSPD-GYLLASGS----------EDGTIRVWDLRTGECVQTLS-GHTNSVTSLAWSPDGKRLASGSAD 282 (289)
T ss_pred -CCceEEE---EEcCC-CcEEEEEc----------CCCcEEEEEcCCceeEEEcc-ccCCcEEEEEECCCCCEEEEecCC
Confidence 2234443 33332 45555443 35899999987554433222 4566788877553 23333333
Q ss_pred CEEEEE
Q 001655 789 QKIQLY 794 (1036)
Q Consensus 789 ~~l~v~ 794 (1036)
..+.+|
T Consensus 283 ~~i~iw 288 (289)
T cd00200 283 GTIRIW 288 (289)
T ss_pred CeEEec
Confidence 355554
No 15
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=97.82 E-value=0.094 Score=58.47 Aligned_cols=350 Identities=15% Similarity=0.197 Sum_probs=196.7
Q ss_pred ceeeeecC-CC-eEEEEe-cCcEEEEecCCccceeeeeCCCC---CcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEE
Q 001655 398 TLFCHDAI-YN-QLVQVT-SGSVRLVSSTSRELRNEWKSPPG---YSVNVATANASQVLLATGGGHLVYLEIGDGILTEV 471 (1036)
Q Consensus 398 Tl~~~~~~-~~-~~vQVt-~~~i~l~~~~~~~~~~~w~~~~~---~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~ 471 (1036)
.|++-... ++ .++-+. .+.+++.+-.+...+.+|..+.. ..+-+.--++..+.|++ +|.+-||+.++.....+
T Consensus 237 sIfalsWsPDs~~~~T~SaDkt~KIWdVs~~slv~t~~~~~~v~dqqvG~lWqkd~lItVSl-~G~in~ln~~d~~~~~~ 315 (603)
T KOG0318|consen 237 SIFALSWSPDSTQFLTVSADKTIKIWDVSTNSLVSTWPMGSTVEDQQVGCLWQKDHLITVSL-SGTINYLNPSDPSVLKV 315 (603)
T ss_pred cEEEEEECCCCceEEEecCCceEEEEEeeccceEEEeecCCchhceEEEEEEeCCeEEEEEc-CcEEEEecccCCChhhe
Confidence 45555542 43 666665 46778888777778888865432 22222223344555555 77888887765432111
Q ss_pred EeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCC---ccCceeEEeeeecCeEEEEEEe
Q 001655 472 KHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGG---EIIPRSVLLCAFEGISYLLCAL 548 (1036)
Q Consensus 472 ~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~---~~~p~si~~~~~~~~~~L~vgl 548 (1036)
..--...|+|++.++ ...++.-|.+ ||.|.=|++....- ..+.. ......+ ...+...+.-+|.
T Consensus 316 -i~GHnK~ITaLtv~~------d~~~i~Sgsy-DG~I~~W~~~~g~~---~~~~g~~h~nqI~~~--~~~~~~~~~t~g~ 382 (603)
T KOG0318|consen 316 -ISGHNKSITALTVSP------DGKTIYSGSY-DGHINSWDSGSGTS---DRLAGKGHTNQIKGM--AASESGELFTIGW 382 (603)
T ss_pred -ecccccceeEEEEcC------CCCEEEeecc-CceEEEEecCCccc---cccccccccceEEEE--eecCCCcEEEEec
Confidence 122346789998854 2467888888 99888888764221 11110 0111111 1112234444555
Q ss_pred CCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccc-cceeeecccCC
Q 001655 549 GDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLK-EVSHMCPFNSA 627 (1036)
Q Consensus 549 ~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~-~i~~~~~f~~~ 627 (1036)
.| .|-+..+.. +.........+|.+|.-+-.. .++..+++++..-.+++.+.++..-.|+... ...+++|-.+
T Consensus 383 Dd-~l~~~~~~~--~~~t~~~~~~lg~QP~~lav~--~d~~~avv~~~~~iv~l~~~~~~~~~~~~y~~s~vAv~~~~~- 456 (603)
T KOG0318|consen 383 DD-TLRVISLKD--NGYTKSEVVKLGSQPKGLAVL--SDGGTAVVACISDIVLLQDQTKVSSIPIGYESSAVAVSPDGS- 456 (603)
T ss_pred CC-eEEEEeccc--CcccccceeecCCCceeEEEc--CCCCEEEEEecCcEEEEecCCcceeeccccccceEEEcCCCC-
Confidence 33 344433321 123333456899999866542 3444666777777777776666544444332 2223332211
Q ss_pred CCCCeEEEEeCCeEEEEEEcCCCC-eEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEE
Q 001655 628 AFPDSLAIAKEGELTIGTIDDIQK-LHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIS 706 (1036)
Q Consensus 628 ~~~~~l~~~~~~~l~i~~l~~~~~-~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~ 706 (1036)
+-.+--.++.+++.+|..... -..+.++....+.-|+|+|+...+|++-.. ..+-++|..+.+...
T Consensus 457 ---~vaVGG~Dgkvhvysl~g~~l~ee~~~~~h~a~iT~vaySpd~~yla~~Da~----------rkvv~yd~~s~~~~~ 523 (603)
T KOG0318|consen 457 ---EVAVGGQDGKVHVYSLSGDELKEEAKLLEHRAAITDVAYSPDGAYLAAGDAS----------RKVVLYDVASREVKT 523 (603)
T ss_pred ---EEEEecccceEEEEEecCCcccceeeeecccCCceEEEECCCCcEEEEeccC----------CcEEEEEcccCceec
Confidence 122334578899999987653 344777888899999999998766655332 246666766655421
Q ss_pred E-EECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEEEEecCceeEeccccCeEE
Q 001655 707 T-YPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAEKETKGAVYSLNAFNGKLL 784 (1036)
Q Consensus 707 ~-~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~~~~~g~v~~i~~~~g~Lv 784 (1036)
. .-|- .-++.|+ .|.- +..+++-|. .. -.+++|++++- +- +..+..+.+.|+++.=++..=+
T Consensus 524 ~~w~FH-takI~~~-aWsP---~n~~vATGS--lD--------t~Viiysv~kP~~~-i~iknAH~~gVn~v~wlde~tv 587 (603)
T KOG0318|consen 524 NRWAFH-TAKINCV-AWSP---NNKLVATGS--LD--------TNVIIYSVKKPAKH-IIIKNAHLGGVNSVAWLDESTV 587 (603)
T ss_pred ceeeee-eeeEEEE-EeCC---CceEEEecc--cc--------ceEEEEEccChhhh-eEeccccccCceeEEEecCceE
Confidence 1 1111 1234554 3432 345555443 21 26899999853 22 4444456667999998888888
Q ss_pred EEECCEEEEEEe
Q 001655 785 AAINQKIQLYKW 796 (1036)
Q Consensus 785 ~~~g~~l~v~~~ 796 (1036)
++.|+.--+..|
T Consensus 588 vSsG~Da~iK~W 599 (603)
T KOG0318|consen 588 VSSGQDANIKVW 599 (603)
T ss_pred EeccCcceeEEe
Confidence 888876555455
No 16
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=97.82 E-value=0.063 Score=56.23 Aligned_cols=144 Identities=15% Similarity=0.229 Sum_probs=97.3
Q ss_pred CCeEEEEe--C-CeEEEEEEcCCCCeEEEEEeCCC----ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCc
Q 001655 630 PDSLAIAK--E-GELTIGTIDDIQKLHIRSIPLGE----HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTF 702 (1036)
Q Consensus 630 ~~~l~~~~--~-~~l~i~~l~~~~~~~~~~i~l~~----tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~ 702 (1036)
|++++++. + +.+++..+-...+=|-+++.++. .-..|-|+++.+.+++.+.. +.+.++|.-++
T Consensus 150 p~GLifA~~~~~~~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~----------s~~~~lDAf~G 219 (311)
T KOG1446|consen 150 PEGLIFALANGSELIKLYDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNA----------SFIYLLDAFDG 219 (311)
T ss_pred CCCcEEEEecCCCeEEEEEecccCCCCceeEccCCCCccceeeeEEcCCCCEEEEEeCC----------CcEEEEEccCC
Confidence 56766653 3 47888888777665666666663 34568899999977776653 57899999999
Q ss_pred eEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccC-
Q 001655 703 EFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNG- 781 (1036)
Q Consensus 703 ~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g- 781 (1036)
..+.+++..+++.-..+. ..|.. ..+|++.|. ..|+|.+|.+..++........-.|++.++. |+-
T Consensus 220 ~~~~tfs~~~~~~~~~~~-a~ftP-ds~Fvl~gs----------~dg~i~vw~~~tg~~v~~~~~~~~~~~~~~~-fnP~ 286 (311)
T KOG1446|consen 220 TVKSTFSGYPNAGNLPLS-ATFTP-DSKFVLSGS----------DDGTIHVWNLETGKKVAVLRGPNGGPVSCVR-FNPR 286 (311)
T ss_pred cEeeeEeeccCCCCccee-EEECC-CCcEEEEec----------CCCcEEEEEcCCCcEeeEecCCCCCCccccc-cCCc
Confidence 999999988887744432 23422 256666664 4599999999766554444434567777777 765
Q ss_pred e-EEEEECCEEEEEEe
Q 001655 782 K-LLAAINQKIQLYKW 796 (1036)
Q Consensus 782 ~-Lv~~~g~~l~v~~~ 796 (1036)
+ ..++.+.++.+|-.
T Consensus 287 ~~mf~sa~s~l~fw~p 302 (311)
T KOG1446|consen 287 YAMFVSASSNLVFWLP 302 (311)
T ss_pred eeeeeecCceEEEEec
Confidence 3 45666777776543
No 17
>PF03178 CPSF_A: CPSF A subunit region; InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=97.81 E-value=0.012 Score=65.59 Aligned_cols=193 Identities=14% Similarity=0.112 Sum_probs=120.2
Q ss_pred CCEEEEEEeecCCCCCceeeEEEEEEeCCC-------ceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCC
Q 001655 672 SRTFAICSLKNQSCAEESEMHFVRLLDDQT-------FEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEEN 744 (1036)
Q Consensus 672 ~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t-------~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~ 744 (1036)
...++|++.....++.....+.+.+++-.. ++.+...++ ...+++++.+ +.++++|.+
T Consensus 42 ~~~ivVGT~~~~~~~~~~~~Gri~v~~i~~~~~~~~~l~~i~~~~~--~g~V~ai~~~------~~~lv~~~g------- 106 (321)
T PF03178_consen 42 KEYIVVGTAFNYGEDPEPSSGRILVFEISESPENNFKLKLIHSTEV--KGPVTAICSF------NGRLVVAVG------- 106 (321)
T ss_dssp SEEEEEEEEE--TTSSS-S-EEEEEEEECSS-----EEEEEEEEEE--SS-EEEEEEE------TTEEEEEET-------
T ss_pred cCEEEEEecccccccccccCcEEEEEEEEcccccceEEEEEEEEee--cCcceEhhhh------CCEEEEeec-------
Confidence 455666666543222222338888887654 344455555 3557888776 345887763
Q ss_pred CCcceEEEEEEEeCCe-EEEEEEEEecCceeEeccccCeEEEEEC-CEEEEEEeeecCCCccchhcccccccceEEEEEE
Q 001655 745 EPTKGRILVFIVEDGK-LQLIAEKETKGAVYSLNAFNGKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQ 822 (1036)
Q Consensus 745 ~~~~Gri~v~~i~~~k-l~~~~~~~~~g~v~~i~~~~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~ 822 (1036)
++|++|++.+.+ +...+....+..++++..++++|+++-- +.+.++.|+.. ..+|...+.-..+..++++.
T Consensus 107 ----~~l~v~~l~~~~~l~~~~~~~~~~~i~sl~~~~~~I~vgD~~~sv~~~~~~~~---~~~l~~va~d~~~~~v~~~~ 179 (321)
T PF03178_consen 107 ----NKLYVYDLDNSKTLLKKAFYDSPFYITSLSVFKNYILVGDAMKSVSLLRYDEE---NNKLILVARDYQPRWVTAAE 179 (321)
T ss_dssp ----TEEEEEEEETTSSEEEEEEE-BSSSEEEEEEETTEEEEEESSSSEEEEEEETT---TE-EEEEEEESS-BEEEEEE
T ss_pred ----CEEEEEEccCcccchhhheecceEEEEEEeccccEEEEEEcccCEEEEEEEcc---CCEEEEEEecCCCccEEEEE
Confidence 589999999887 9999999888999999999999988865 78889988642 23344333211233445544
Q ss_pred E--eCCEEEEEeccccEEEEEEecc------CC-eEEEEeccCCcceeEEE---EEee----Cc-----eEEEEccCCcE
Q 001655 823 T--RGDFIVVGDLMKSISLLIYKHE------EG-AIEERARDYNANWMSAV---EILD----DD-----IYLGAENNFNL 881 (1036)
Q Consensus 823 ~--~~~~I~vgD~~~Sv~~~~~~~~------~~-~l~~~a~D~~~~~~~~~---~~l~----~~-----~~l~~D~~gnl 881 (1036)
. .++.++++|....+.+++++++ .. +|...+.=.....+++. .+.. .+ .++.+-.+|.|
T Consensus 180 ~l~d~~~~i~~D~~gnl~~l~~~~~~~~~~~~~~~L~~~~~f~lg~~v~~~~~~~l~~~~~~~~~~~~~~i~~~T~~G~I 259 (321)
T PF03178_consen 180 FLVDEDTIIVGDKDGNLFVLRYNPEIPNSRDGDPKLERISSFHLGDIVNSFRRGSLIPRSGSSESPNRPQILYGTVDGSI 259 (321)
T ss_dssp EE-SSSEEEEEETTSEEEEEEE-SS-SSTTTTTTBEEEEEEEE-SS-EEEEEE--SS--SSSS-TTEEEEEEEEETTS-E
T ss_pred EecCCcEEEEEcCCCeEEEEEECCCCcccccccccceeEEEEECCCccceEEEEEeeecCCCCcccccceEEEEecCCEE
Confidence 4 3469999999999999999863 23 67777755444455554 2222 11 26777789999
Q ss_pred EEEee
Q 001655 882 FTVRK 886 (1036)
Q Consensus 882 ~~l~~ 886 (1036)
..+..
T Consensus 260 g~l~p 264 (321)
T PF03178_consen 260 GVLIP 264 (321)
T ss_dssp EEEEE
T ss_pred EEEEe
Confidence 96653
No 18
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=97.80 E-value=0.099 Score=57.95 Aligned_cols=386 Identities=14% Similarity=0.207 Sum_probs=202.7
Q ss_pred cEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEE----EeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEE
Q 001655 438 SVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEV----KHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIF 511 (1036)
Q Consensus 438 ~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~----~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~ 511 (1036)
.+..|+.. +..++++...+.+.+.....+.|.+. ++.+- +-|.|+.+.+ ..-++-| ..+|.|.||
T Consensus 202 ~v~~a~FHPtd~nliit~Gk~H~~Fw~~~~~~l~k~~~~fek~ek-k~Vl~v~F~e-------ngdviTg-DS~G~i~Iw 272 (626)
T KOG2106|consen 202 VVFLATFHPTDPNLIITCGKGHLYFWTLRGGSLVKRQGIFEKREK-KFVLCVTFLE-------NGDVITG-DSGGNILIW 272 (626)
T ss_pred eEEEEEeccCCCcEEEEeCCceEEEEEccCCceEEEeeccccccc-eEEEEEEEcC-------CCCEEee-cCCceEEEE
Confidence 45556655 55778888778888876655545442 22222 5688999864 2233444 348999999
Q ss_pred ECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecC----CCccccceeeec--CccceEEEEEEe
Q 001655 512 SLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMK----TGELTDRKKVSL--GTQPITLRTFSS 585 (1036)
Q Consensus 512 ~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~----~~~l~~~~~~~l--G~~pv~l~~~~~ 585 (1036)
+-....+..... .. ++..+-++.++||.|+.=.-|.. +..++..+...+ ..-|++-..
T Consensus 273 ~~~~~~~~k~~~-aH------------~ggv~~L~~lr~GtllSGgKDRki~~Wd~~y~k~r~~elPe~~G~iRtv~--- 336 (626)
T KOG2106|consen 273 SKGTNRISKQVH-AH------------DGGVFSLCMLRDGTLLSGGKDRKIILWDDNYRKLRETELPEQFGPIRTVA--- 336 (626)
T ss_pred eCCCceEEeEee-ec------------CCceEEEEEecCccEeecCccceEEeccccccccccccCchhcCCeeEEe---
Confidence 975544322111 11 23456677777777765211100 000111111111 111333221
Q ss_pred CCceEEEEEcCCceEEEec-CCcEEEe-eeccccceeeecccCCCCCCeEEEE-eCCeEEEEEEcCCCCeEEEEEeCCCc
Q 001655 586 KNTTHVFAASDRPTVIYSS-NKKLLYS-NVNLKEVSHMCPFNSAAFPDSLAIA-KEGELTIGTIDDIQKLHIRSIPLGEH 662 (1036)
Q Consensus 586 ~~~~~v~~~~~~p~~i~~~-~~~~~~~-~~~~~~i~~~~~f~~~~~~~~l~~~-~~~~l~i~~l~~~~~~~~~~i~l~~t 662 (1036)
.+...+++-..|-.++..+ ++++... ....+....++.- ...+.++-+ .++.+++=+ ..+ ..-+..+++.
T Consensus 337 e~~~di~vGTtrN~iL~Gt~~~~f~~~v~gh~delwgla~h---ps~~q~~T~gqdk~v~lW~---~~k-~~wt~~~~d~ 409 (626)
T KOG2106|consen 337 EGKGDILVGTTRNFILQGTLENGFTLTVQGHGDELWGLATH---PSKNQLLTCGQDKHVRLWN---DHK-LEWTKIIEDP 409 (626)
T ss_pred cCCCcEEEeeccceEEEeeecCCceEEEEecccceeeEEcC---CChhheeeccCcceEEEcc---CCc-eeEEEEecCc
Confidence 2334466666777777654 3444322 2222333332211 111222222 244444444 223 2334456677
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCC
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPE 742 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~ 742 (1036)
.+...+||.. .+++.+.. +..-++|-.+-..+.- .-+ +|.+.++. +. ....+++||+
T Consensus 410 ~~~~~fhpsg-~va~Gt~~----------G~w~V~d~e~~~lv~~-~~d-~~~ls~v~---ys-p~G~~lAvgs------ 466 (626)
T KOG2106|consen 410 AECADFHPSG-VVAVGTAT----------GRWFVLDTETQDLVTI-HTD-NEQLSVVR---YS-PDGAFLAVGS------ 466 (626)
T ss_pred eeEeeccCcc-eEEEeecc----------ceEEEEecccceeEEE-Eec-CCceEEEE---Ec-CCCCEEEEec------
Confidence 8889999887 77777753 4566777776444433 233 78776654 32 3468999998
Q ss_pred CCCCcceEEEEEEEeCC--eEEEEEEEEecCceeEeccc-cCeEEEEECCEEEEEEeeecCCCccchhc--ccccccce-
Q 001655 743 ENEPTKGRILVFIVEDG--KLQLIAEKETKGAVYSLNAF-NGKLLAAINQKIQLYKWMLRDDGTRELQS--ECGHHGHI- 816 (1036)
Q Consensus 743 e~~~~~Gri~v~~i~~~--kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~--~~~~~~~~- 816 (1036)
..+.||+|.++.+ |++.+.+..- .|++.+.-- ++..+.+....-.+.-|... .-++... ...|.+..
T Consensus 467 ----~d~~iyiy~Vs~~g~~y~r~~k~~g-s~ithLDwS~Ds~~~~~~S~d~eiLyW~~~--~~~~~ts~kDvkW~t~~c 539 (626)
T KOG2106|consen 467 ----HDNHIYIYRVSANGRKYSRVGKCSG-SPITHLDWSSDSQFLVSNSGDYEILYWKPS--ECKQITSVKDVKWATYTC 539 (626)
T ss_pred ----CCCeEEEEEECCCCcEEEEeeeecC-ceeEEeeecCCCceEEeccCceEEEEEccc--cCcccceecceeeeeeEE
Confidence 3468999999944 5555555544 777777633 55566655544444445321 1111111 00111110
Q ss_pred ---------------EEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCce-EEEEccCCc
Q 001655 817 ---------------LALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDI-YLGAENNFN 880 (1036)
Q Consensus 817 ---------------~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~-~l~~D~~gn 880 (1036)
.+++-.-.++.+..||..--+-+++|-....+-.-.-.--..+.++++.|+-++. ++.+-++-.
T Consensus 540 ~lGF~v~g~s~~t~i~a~~rs~~~~~lA~gdd~g~v~lf~yPc~s~rA~~he~~ghs~~vt~V~Fl~~d~~li~tg~D~S 619 (626)
T KOG2106|consen 540 TLGFEVFGGSDGTDINAVARSHCEKLLASGDDFGKVHLFSYPCSSPRAPSHEYGGHSSHVTNVAFLCKDSHLISTGKDTS 619 (626)
T ss_pred EEEEEEecccCCchHHHhhhhhhhhhhhccccCceEEEEccccCCCcccceeeccccceeEEEEEeeCCceEEecCCCce
Confidence 1112223567888999999999998865433222222233567789999997765 444445655
Q ss_pred EEEEe
Q 001655 881 LFTVR 885 (1036)
Q Consensus 881 l~~l~ 885 (1036)
++..+
T Consensus 620 i~qW~ 624 (626)
T KOG2106|consen 620 IMQWR 624 (626)
T ss_pred EEEEE
Confidence 55443
No 19
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.78 E-value=0.15 Score=59.34 Aligned_cols=225 Identities=16% Similarity=0.248 Sum_probs=131.2
Q ss_pred CCCeEEEEeCCeEEEEEEcCCCCe-----EEEEEeCCC---ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCC
Q 001655 629 FPDSLAIAKEGELTIGTIDDIQKL-----HIRSIPLGE---HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQ 700 (1036)
Q Consensus 629 ~~~~l~~~~~~~l~i~~l~~~~~~-----~~~~i~l~~---tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~ 700 (1036)
.++.+++.++|.+....++...+. .++.+.+++ ..|.++++.+.. ++++. ...++++.+.+
T Consensus 334 ~~~~lv~l~nNtv~~ysl~~s~~~~p~~~~~~~i~~~GHR~dVRsl~vS~d~~--~~~Sg---------a~~SikiWn~~ 402 (888)
T KOG0306|consen 334 TENTLVLLANNTVEWYSLENSGKTSPEADRTSNIEIGGHRSDVRSLCVSSDSI--LLASG---------AGESIKIWNRD 402 (888)
T ss_pred cceeEEEeecCceEEEEeccCCCCCccccccceeeeccchhheeEEEeecCce--eeeec---------CCCcEEEEEcc
Confidence 345677788999999998873322 233444432 456666665433 22222 12479999999
Q ss_pred CceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeE-EEEEEEEecCceeEeccc
Q 001655 701 TFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKL-QLIAEKETKGAVYSLNAF 779 (1036)
Q Consensus 701 t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl-~~~~~~~~~g~v~~i~~~ 779 (1036)
+.+.+-+++-. .+.|.+.+ .+..|+++|+ ..|.+.+|++....+ +.+- .+.|++-+|...
T Consensus 403 t~kciRTi~~~---y~l~~~Fv----pgd~~Iv~G~----------k~Gel~vfdlaS~~l~Eti~--AHdgaIWsi~~~ 463 (888)
T KOG0306|consen 403 TLKCIRTITCG---YILASKFV----PGDRYIVLGT----------KNGELQVFDLASASLVETIR--AHDGAIWSISLS 463 (888)
T ss_pred CcceeEEeccc---cEEEEEec----CCCceEEEec----------cCCceEEEEeehhhhhhhhh--ccccceeeeeec
Confidence 99888876654 55555443 2478999998 679999999874432 2222 567888777766
Q ss_pred ---cCeEEEEECCEEEEEEeeecCC--Cc-cchhc---ccccccc--eEEEEEEEeCCEEEEEeccccEEEEEEeccCCe
Q 001655 780 ---NGKLLAAINQKIQLYKWMLRDD--GT-RELQS---ECGHHGH--ILALYVQTRGDFIVVGDLMKSISLLIYKHEEGA 848 (1036)
Q Consensus 780 ---~g~Lv~~~g~~l~v~~~~~~~~--~~-~~L~~---~~~~~~~--~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~ 848 (1036)
.|.+.++..++|.+|++..-.. |. ++... ....... ..+++++..+.++.||=+..-+.+|..+.-.-.
T Consensus 464 pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDtlKFf 543 (888)
T KOG0306|consen 464 PDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDTLKFF 543 (888)
T ss_pred CCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEecceeee
Confidence 3456667778898887753211 22 12111 1112222 334445555778888887777877766543333
Q ss_pred EEEEeccCCcceeEEEEEeeCc-eEEEEccCCcEEEEee
Q 001655 849 IEERARDYNANWMSAVEILDDD-IYLGAENNFNLFTVRK 886 (1036)
Q Consensus 849 l~~~a~D~~~~~~~~~~~l~~~-~~l~~D~~gnl~~l~~ 886 (1036)
+.+-+ +...|.++..--+. .++.+-.+.|+-+.-.
T Consensus 544 lsLYG---HkLPV~smDIS~DSklivTgSADKnVKiWGL 579 (888)
T KOG0306|consen 544 LSLYG---HKLPVLSMDISPDSKLIVTGSADKNVKIWGL 579 (888)
T ss_pred eeecc---cccceeEEeccCCcCeEEeccCCCceEEecc
Confidence 33333 34556666543232 3555445555555443
No 20
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=97.60 E-value=0.09 Score=56.40 Aligned_cols=222 Identities=18% Similarity=0.201 Sum_probs=121.9
Q ss_pred eEEEEe-CCeEEEEEEcCCCCeEEEEEeCCC-ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE
Q 001655 632 SLAIAK-EGELTIGTIDDIQKLHIRSIPLGE-HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP 709 (1036)
Q Consensus 632 ~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~-tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~ 709 (1036)
.++... ++.+.+..++.... .+...... ....+.+.+..+.+++++.. +.++++|..+.+.+..+.
T Consensus 23 ~l~~~~~~g~i~i~~~~~~~~--~~~~~~~~~~i~~~~~~~~~~~l~~~~~~----------~~i~i~~~~~~~~~~~~~ 90 (289)
T cd00200 23 LLATGSGDGTIKVWDLETGEL--LRTLKGHTGPVRDVAASADGTYLASGSSD----------KTIRLWDLETGECVRTLT 90 (289)
T ss_pred EEEEeecCcEEEEEEeeCCCc--EEEEecCCcceeEEEECCCCCEEEEEcCC----------CeEEEEEcCcccceEEEe
Confidence 344444 67788887765432 22333322 33478888887766666543 478888887765555544
Q ss_pred CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc-CeE-EEEE
Q 001655 710 LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN-GKL-LAAI 787 (1036)
Q Consensus 710 ~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~-g~L-v~~~ 787 (1036)
.. ...+.++. +..+ ..+++.|. ..|.+.+|++..++...... ...+++++++... +.+ +++.
T Consensus 91 ~~-~~~i~~~~---~~~~-~~~~~~~~----------~~~~i~~~~~~~~~~~~~~~-~~~~~i~~~~~~~~~~~l~~~~ 154 (289)
T cd00200 91 GH-TSYVSSVA---FSPD-GRILSSSS----------RDKTIKVWDVETGKCLTTLR-GHTDWVNSVAFSPDGTFVASSS 154 (289)
T ss_pred cc-CCcEEEEE---EcCC-CCEEEEec----------CCCeEEEEECCCcEEEEEec-cCCCcEEEEEEcCcCCEEEEEc
Confidence 22 22455543 2222 45665554 35789999987554433222 4567888887664 444 4444
Q ss_pred -CCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEE
Q 001655 788 -NQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEI 866 (1036)
Q Consensus 788 -g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~ 866 (1036)
+..+++|++.. + +.+............+.....++.++++.....+.++ +....+....-+ .....+.++.+
T Consensus 155 ~~~~i~i~d~~~---~-~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~--d~~~~~~~~~~~-~~~~~i~~~~~ 227 (289)
T cd00200 155 QDGTIKLWDLRT---G-KCVATLTGHTGEVNSVAFSPDGEKLLSSSSDGTIKLW--DLSTGKCLGTLR-GHENGVNSVAF 227 (289)
T ss_pred CCCcEEEEEccc---c-ccceeEecCccccceEEECCCcCEEEEecCCCcEEEE--ECCCCceecchh-hcCCceEEEEE
Confidence 67888887631 1 1111111111122223333344588888886667665 433333222111 22335667776
Q ss_pred eeCce-EEEEccCCcEEEEeeCC
Q 001655 867 LDDDI-YLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 867 l~~~~-~l~~D~~gnl~~l~~~~ 888 (1036)
..++. +++++.+|.+.++....
T Consensus 228 ~~~~~~~~~~~~~~~i~i~~~~~ 250 (289)
T cd00200 228 SPDGYLLASGSEDGTIRVWDLRT 250 (289)
T ss_pred cCCCcEEEEEcCCCcEEEEEcCC
Confidence 65554 45566699999998653
No 21
>PF10282 Lactonase: Lactonase, 7-bladed beta-propeller; InterPro: IPR019405 6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types. This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.59 E-value=0.22 Score=56.16 Aligned_cols=296 Identities=19% Similarity=0.211 Sum_probs=165.5
Q ss_pred EEEEEeCC----CcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCC----ceEEE---ecC-CcEEE
Q 001655 543 YLLCALGD----GHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDR----PTVIY---SSN-KKLLY 610 (1036)
Q Consensus 543 ~L~vgl~~----G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~----p~~i~---~~~-~~~~~ 610 (1036)
.++||+.+ |-+..|++|..++.|........+..|--|.. ..+...++++.+. ..+.. ..+ +.+..
T Consensus 1 ~~~vgsy~~~~~~gI~~~~~d~~~g~l~~~~~~~~~~~Ps~l~~--~~~~~~LY~~~e~~~~~g~v~~~~i~~~~g~L~~ 78 (345)
T PF10282_consen 1 TLYVGSYTNGKGGGIYVFRFDEETGTLTLVQTVAEGENPSWLAV--SPDGRRLYVVNEGSGDSGGVSSYRIDPDTGTLTL 78 (345)
T ss_dssp EEEEEECCSSSSTEEEEEEEETTTTEEEEEEEEEESSSECCEEE---TTSSEEEEEETTSSTTTEEEEEEEETTTTEEEE
T ss_pred CEEEEcCCCCCCCcEEEEEEcCCCCCceEeeeecCCCCCceEEE--EeCCCEEEEEEccccCCCCEEEEEECCCcceeEE
Confidence 47888877 78999999988888876655556666644432 2345677777653 23321 112 45532
Q ss_pred eeeccccceeeecccCCCCCCeEEEEe--CCeEEEEEEcCCCCeEEE--EE-----------eCCCccceEEEecCCCEE
Q 001655 611 SNVNLKEVSHMCPFNSAAFPDSLAIAK--EGELTIGTIDDIQKLHIR--SI-----------PLGEHPRRICHQEQSRTF 675 (1036)
Q Consensus 611 ~~~~~~~i~~~~~f~~~~~~~~l~~~~--~~~l~i~~l~~~~~~~~~--~i-----------~l~~tp~~i~y~~~~~~~ 675 (1036)
..-....-..-|.+........++.+. ++.+.+..++...++... .+ .-+..|+.+.++|+.+.+
T Consensus 79 ~~~~~~~g~~p~~i~~~~~g~~l~vany~~g~v~v~~l~~~g~l~~~~~~~~~~g~g~~~~rq~~~h~H~v~~~pdg~~v 158 (345)
T PF10282_consen 79 LNSVPSGGSSPCHIAVDPDGRFLYVANYGGGSVSVFPLDDDGSLGEVVQTVRHEGSGPNPDRQEGPHPHQVVFSPDGRFV 158 (345)
T ss_dssp EEEEEESSSCEEEEEECTTSSEEEEEETTTTEEEEEEECTTSEEEEEEEEEESEEEESSTTTTSSTCEEEEEE-TTSSEE
T ss_pred eeeeccCCCCcEEEEEecCCCEEEEEEccCCeEEEEEccCCcccceeeeecccCCCCCcccccccccceeEEECCCCCEE
Confidence 211100000111111111222344443 788999999876433221 22 123568899999998877
Q ss_pred EEEEeecCCCCCceeeEEEEEEe--CCC--ceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEE
Q 001655 676 AICSLKNQSCAEESEMHFVRLLD--DQT--FEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRI 751 (1036)
Q Consensus 676 ~v~~~~~~~~~~~~~~~~l~l~d--~~t--~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri 751 (1036)
.|..... -.|.+++ ..+ .+....+.++++.-+-.+. |..+++.+++++- ..+.|
T Consensus 159 ~v~dlG~---------D~v~~~~~~~~~~~l~~~~~~~~~~G~GPRh~~---f~pdg~~~Yv~~e----------~s~~v 216 (345)
T PF10282_consen 159 YVPDLGA---------DRVYVYDIDDDTGKLTPVDSIKVPPGSGPRHLA---FSPDGKYAYVVNE----------LSNTV 216 (345)
T ss_dssp EEEETTT---------TEEEEEEE-TTS-TEEEEEEEECSTTSSEEEEE---E-TTSSEEEEEET----------TTTEE
T ss_pred EEEecCC---------CEEEEEEEeCCCceEEEeeccccccCCCCcEEE---EcCCcCEEEEecC----------CCCcE
Confidence 7665422 1455554 333 3345667788887776553 4444455555442 56799
Q ss_pred EEEEEe--CCeEEEEEEEEec-----C--ceeEeccc-cC-eEEEEEC--CEEEEEEeeecCCCccchhccccccc-ceE
Q 001655 752 LVFIVE--DGKLQLIAEKETK-----G--AVYSLNAF-NG-KLLAAIN--QKIQLYKWMLRDDGTRELQSECGHHG-HIL 817 (1036)
Q Consensus 752 ~v~~i~--~~kl~~~~~~~~~-----g--~v~~i~~~-~g-~Lv~~~g--~~l~v~~~~~~~~~~~~L~~~~~~~~-~~~ 817 (1036)
.+|++. +++++.+.....- + ....|+-- +| +|+++.. +.|.+|+++. +.|..++... ..+ -..
T Consensus 217 ~v~~~~~~~g~~~~~~~~~~~~~~~~~~~~~~~i~ispdg~~lyvsnr~~~sI~vf~~d~-~~g~l~~~~~--~~~~G~~ 293 (345)
T PF10282_consen 217 SVFDYDPSDGSLTEIQTISTLPEGFTGENAPAEIAISPDGRFLYVSNRGSNSISVFDLDP-ATGTLTLVQT--VPTGGKF 293 (345)
T ss_dssp EEEEEETTTTEEEEEEEEESCETTSCSSSSEEEEEE-TTSSEEEEEECTTTEEEEEEECT-TTTTEEEEEE--EEESSSS
T ss_pred EEEeecccCCceeEEEEeeeccccccccCCceeEEEecCCCEEEEEeccCCEEEEEEEec-CCCceEEEEE--EeCCCCC
Confidence 999999 6677776655432 2 23444433 44 5666553 5899999843 2233333222 221 112
Q ss_pred EEEE--EEeCCEEEEEecc-ccEEEEEEeccCCeEEEEeccCCcceeEEEE
Q 001655 818 ALYV--QTRGDFIVVGDLM-KSISLLIYKHEEGAIEERARDYNANWMSAVE 865 (1036)
Q Consensus 818 ~~~l--~~~~~~I~vgD~~-~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~ 865 (1036)
|-.+ +-.|++++|+... +.|.+++.+.+.++|..+++....-..+|+.
T Consensus 294 Pr~~~~s~~g~~l~Va~~~s~~v~vf~~d~~tG~l~~~~~~~~~~~p~ci~ 344 (345)
T PF10282_consen 294 PRHFAFSPDGRYLYVANQDSNTVSVFDIDPDTGKLTPVGSSVPIPSPVCIV 344 (345)
T ss_dssp EEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEEESSSEEEEE
T ss_pred ccEEEEeCCCCEEEEEecCCCeEEEEEEeCCCCcEEEecccccCCCCEEEe
Confidence 4444 4478899998744 5688888888889998887643333333443
No 22
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=97.55 E-value=0.33 Score=57.31 Aligned_cols=208 Identities=14% Similarity=0.194 Sum_probs=105.3
Q ss_pred ccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEE-eeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeec
Q 001655 495 SQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVL-LCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSL 573 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~-~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~l 573 (1036)
+.+.+..+- +++.++|+...+.+++.. ...|..|. +.. .+.+.+++.++ .+..|.-... +. .....
T Consensus 46 ~~~~vtt~v-gksfqvYd~~kl~ll~vs----~~lp~~I~alas--~~~~vy~A~g~-~i~~~~rgk~---i~--~~~~~ 112 (910)
T KOG1539|consen 46 STFYVTTCV-GKSFQVYDVNKLNLLFVS----KPLPDKITALAS--DKDYVYVASGN-KIYAYARGKH---IR--HTTLL 112 (910)
T ss_pred ceEEEEEec-CceEEEEeccceEEEEec----CCCCCceEEEEe--cCceEEEecCc-EEEEEEccce---EE--EEecc
Confidence 445555555 889999999998887643 12445552 332 46788888765 3555543210 00 01111
Q ss_pred CccceE-EEEEEeCCceEEEEEcCC-ceEEEec-C---C-c--EEEeeeccccceeeecccCCCCCCe-EEEEeCCeEEE
Q 001655 574 GTQPIT-LRTFSSKNTTHVFAASDR-PTVIYSS-N---K-K--LLYSNVNLKEVSHMCPFNSAAFPDS-LAIAKEGELTI 643 (1036)
Q Consensus 574 G~~pv~-l~~~~~~~~~~v~~~~~~-p~~i~~~-~---~-~--~~~~~~~~~~i~~~~~f~~~~~~~~-l~~~~~~~l~i 643 (1036)
+..-|. |.+| | ..++++-.+ -..+... . + . ..+.+...+.|.+++ |...+-+- ++..+++.|.|
T Consensus 113 ~~a~v~~l~~f---G-e~lia~d~~~~l~vw~~s~~~~e~~l~~~~~~~~~~~Ital~--HP~TYLNKIvvGs~~G~lql 186 (910)
T KOG1539|consen 113 HGAKVHLLLPF---G-EHLIAVDISNILFVWKTSSIQEELYLQSTFLKVEGDFITALL--HPSTYLNKIVVGSSQGRLQL 186 (910)
T ss_pred ccceEEEEeee---c-ceEEEEEccCcEEEEEeccccccccccceeeeccCCceeeEe--cchhheeeEEEeecCCcEEE
Confidence 222222 2333 1 122222222 1222111 1 1 1 123333333344433 22223344 44478999999
Q ss_pred EEEcCCCCeEE-EEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEE
Q 001655 644 GTIDDIQKLHI-RSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSC 722 (1036)
Q Consensus 644 ~~l~~~~~~~~-~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~ 722 (1036)
-++.+..-.+. +... ...+.+.-.|.....+|++.. +.|-+++-+..+++-+++-+. -.|+ ++
T Consensus 187 ~Nvrt~K~v~~f~~~~--s~IT~ieqsPaLDVVaiG~~~----------G~ViifNlK~dkil~sFk~d~-g~Vt---sl 250 (910)
T KOG1539|consen 187 WNVRTGKVVYTFQEFF--SRITAIEQSPALDVVAIGLEN----------GTVIIFNLKFDKILMSFKQDW-GRVT---SL 250 (910)
T ss_pred EEeccCcEEEEecccc--cceeEeccCCcceEEEEeccC----------ceEEEEEcccCcEEEEEEccc-ccee---EE
Confidence 99886543221 1111 222334445566666666642 678888888888887766552 2333 44
Q ss_pred EEcCCCceEEEEEee
Q 001655 723 SFSDDSNVYYCVGTA 737 (1036)
Q Consensus 723 ~l~~~~~~~i~VGT~ 737 (1036)
.|..++.+.+++|+.
T Consensus 251 SFrtDG~p~las~~~ 265 (910)
T KOG1539|consen 251 SFRTDGNPLLASGRS 265 (910)
T ss_pred EeccCCCeeEEeccC
Confidence 666677777777764
No 23
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=97.45 E-value=0.32 Score=54.55 Aligned_cols=270 Identities=16% Similarity=0.151 Sum_probs=142.1
Q ss_pred cCCeEEEEEEcC-cEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC-CCeeEEecCCCccCce
Q 001655 454 GGGHLVYLEIGD-GILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD-LNLITKEHLGGEIIPR 531 (1036)
Q Consensus 454 ~~~~~~~l~~~~-~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~-l~~v~~~~l~~~~~p~ 531 (1036)
.++.+..++++. +++..+...+....++.+++++ ...+++++.+.++.+.+|++.+ .++......+....|.
T Consensus 10 ~~~~I~~~~~~~~g~l~~~~~~~~~~~~~~l~~sp------d~~~lyv~~~~~~~i~~~~~~~~g~l~~~~~~~~~~~p~ 83 (330)
T PRK11028 10 ESQQIHVWNLNHEGALTLLQVVDVPGQVQPMVISP------DKRHLYVGVRPEFRVLSYRIADDGALTFAAESPLPGSPT 83 (330)
T ss_pred CCCCEEEEEECCCCceeeeeEEecCCCCccEEECC------CCCEEEEEECCCCcEEEEEECCCCceEEeeeecCCCCce
Confidence 356677777753 5666665555556677888765 2568888888788999999863 2221111111112455
Q ss_pred eEEeeeecCeEEEEEE-eCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEE-EecCCcEE
Q 001655 532 SVLLCAFEGISYLLCA-LGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVI-YSSNKKLL 609 (1036)
Q Consensus 532 si~~~~~~~~~~L~vg-l~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i-~~~~~~~~ 609 (1036)
.+.+.+ +..+|+++ ..+|.+..|.++.. +.+.. ++ ..+. + ...|.-+ +..++++
T Consensus 84 ~i~~~~--~g~~l~v~~~~~~~v~v~~~~~~-g~~~~---------~~--~~~~--~-------~~~~~~~~~~p~g~~- 139 (330)
T PRK11028 84 HISTDH--QGRFLFSASYNANCVSVSPLDKD-GIPVA---------PI--QIIE--G-------LEGCHSANIDPDNRT- 139 (330)
T ss_pred EEEECC--CCCEEEEEEcCCCeEEEEEECCC-CCCCC---------ce--eecc--C-------CCcccEeEeCCCCCE-
Confidence 554442 34456654 45888888887642 21110 00 0000 0 0111111 1111221
Q ss_pred EeeeccccceeeecccCCCCCCeEEEE--eCCeEEEEEEcCCCCe-----EEEEEeCCCccceEEEecCCCEEEEEEeec
Q 001655 610 YSNVNLKEVSHMCPFNSAAFPDSLAIA--KEGELTIGTIDDIQKL-----HIRSIPLGEHPRRICHQEQSRTFAICSLKN 682 (1036)
Q Consensus 610 ~~~~~~~~i~~~~~f~~~~~~~~l~~~--~~~~l~i~~l~~~~~~-----~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~ 682 (1036)
++.+ ..+.+.+..++....+ ...+++.+..|+.++++|+.+.+.|++..
T Consensus 140 -----------------------l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~~~~~g~~p~~~~~~pdg~~lyv~~~~- 195 (330)
T PRK11028 140 -----------------------LWVPCLKEDRIRLFTLSDDGHLVAQEPAEVTTVEGAGPRHMVFHPNQQYAYCVNEL- 195 (330)
T ss_pred -----------------------EEEeeCCCCEEEEEEECCCCcccccCCCceecCCCCCCceEEECCCCCEEEEEecC-
Confidence 1111 1355666666543222 12346678899999999998877776532
Q ss_pred CCCCCceeeEEEEEEeCC----CceEEEEEEC-CC---CCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEE
Q 001655 683 QSCAEESEMHFVRLLDDQ----TFEFISTYPL-DT---FEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVF 754 (1036)
Q Consensus 683 ~~~~~~~~~~~l~l~d~~----t~~~i~~~~~-~~---~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~ 754 (1036)
...|.+++-+ +++.+.++.. ++ ++. .. ..+.+..+ .+++.|+.. ..+.|.+|
T Consensus 196 --------~~~v~v~~~~~~~~~~~~~~~~~~~p~~~~~~~-~~-~~i~~~pd-g~~lyv~~~---------~~~~I~v~ 255 (330)
T PRK11028 196 --------NSSVDVWQLKDPHGEIECVQTLDMMPADFSDTR-WA-ADIHITPD-GRHLYACDR---------TASLISVF 255 (330)
T ss_pred --------CCEEEEEEEeCCCCCEEEEEEEecCCCcCCCCc-cc-eeEEECCC-CCEEEEecC---------CCCeEEEE
Confidence 2456665532 3344444432 21 111 11 12344433 456666531 34689999
Q ss_pred EEeC--CeEEEEEEEEecCceeEeccc-cC-eEEEEE--CCEEEEEEee
Q 001655 755 IVED--GKLQLIAEKETKGAVYSLNAF-NG-KLLAAI--NQKIQLYKWM 797 (1036)
Q Consensus 755 ~i~~--~kl~~~~~~~~~g~v~~i~~~-~g-~Lv~~~--g~~l~v~~~~ 797 (1036)
++.. .+++++........+..+.-- +| +|+++. .++|.+|+++
T Consensus 256 ~i~~~~~~~~~~~~~~~~~~p~~~~~~~dg~~l~va~~~~~~v~v~~~~ 304 (330)
T PRK11028 256 SVSEDGSVLSFEGHQPTETQPRGFNIDHSGKYLIAAGQKSHHISVYEID 304 (330)
T ss_pred EEeCCCCeEEEeEEEeccccCCceEECCCCCEEEEEEccCCcEEEEEEc
Confidence 9973 467766665554344455422 34 566554 3589999875
No 24
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=97.44 E-value=0.049 Score=56.53 Aligned_cols=265 Identities=16% Similarity=0.218 Sum_probs=143.3
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCC-CeeE--EecCCCccCceeEEeeeecCeEEEEEEeCCCcE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDL-NLIT--KEHLGGEIIPRSVLLCAFEGISYLLCALGDGHL 553 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l-~~v~--~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l 553 (1036)
+..|++|+++|. ....++.|.| ||.+++|.+.+- ..+- .+.+. .++=+++- ..+...++.|.-||.+
T Consensus 27 ~DsIS~l~FSP~-----~~~~~~A~SW-D~tVR~wevq~~g~~~~ka~~~~~--~PvL~v~W--sddgskVf~g~~Dk~~ 96 (347)
T KOG0647|consen 27 EDSISALAFSPQ-----ADNLLAAGSW-DGTVRIWEVQNSGQLVPKAQQSHD--GPVLDVCW--SDDGSKVFSGGCDKQA 96 (347)
T ss_pred ccchheeEeccc-----cCceEEeccc-CCceEEEEEecCCcccchhhhccC--CCeEEEEE--ccCCceEEeeccCCce
Confidence 456899999873 2567779999 999999998762 2221 12222 12222221 2355789999999999
Q ss_pred EEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeec---------c-ccceeeec
Q 001655 554 LNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVN---------L-KEVSHMCP 623 (1036)
Q Consensus 554 ~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~---------~-~~i~~~~~ 623 (1036)
-.|.+... .+ ..+..=..||+-..+-.+...-.+++|+ .+..++|.... . +.+.++.-
T Consensus 97 k~wDL~S~--Q~---~~v~~Hd~pvkt~~wv~~~~~~cl~TGS-------WDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv 164 (347)
T KOG0647|consen 97 KLWDLASG--QV---SQVAAHDAPVKTCHWVPGMNYQCLVTGS-------WDKTLKFWDTRSSNPVATLQLPERVYAADV 164 (347)
T ss_pred EEEEccCC--Ce---eeeeecccceeEEEEecCCCcceeEecc-------cccceeecccCCCCeeeeeeccceeeehhc
Confidence 98887643 11 2233335666544441111122344442 13334443222 1 11111111
Q ss_pred ccCCCCCCeEEEEeCCeEEEEEEcCCC-CeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCC--
Q 001655 624 FNSAAFPDSLAIAKEGELTIGTIDDIQ-KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQ-- 700 (1036)
Q Consensus 624 f~~~~~~~~l~~~~~~~l~i~~l~~~~-~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~-- 700 (1036)
. .|=..+...+..+.+.+|.... .+-.-.-||....|.|+-.++...++++..+ .+-.++-+|+.
T Consensus 165 ~----~pm~vVata~r~i~vynL~n~~te~k~~~SpLk~Q~R~va~f~d~~~~alGsiE--------Grv~iq~id~~~~ 232 (347)
T KOG0647|consen 165 L----YPMAVVATAERHIAVYNLENPPTEFKRIESPLKWQTRCVACFQDKDGFALGSIE--------GRVAIQYIDDPNP 232 (347)
T ss_pred c----CceeEEEecCCcEEEEEcCCCcchhhhhcCcccceeeEEEEEecCCceEeeeec--------ceEEEEecCCCCc
Confidence 1 1112333458889999995543 2323344677778888888888889888774 23455666652
Q ss_pred ----CceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEe
Q 001655 701 ----TFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSL 776 (1036)
Q Consensus 701 ----t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i 776 (1036)
+|+...+-.. -+..|+++-++.|.-....+.-+| .-|++-.|+-+ -+-++......++|+++.
T Consensus 233 ~~nFtFkCHR~~~~-~~~~VYaVNsi~FhP~hgtlvTaG-----------sDGtf~FWDkd-ar~kLk~s~~~~qpItcc 299 (347)
T KOG0647|consen 233 KDNFTFKCHRSTNS-VNDDVYAVNSIAFHPVHGTLVTAG-----------SDGTFSFWDKD-ARTKLKTSETHPQPITCC 299 (347)
T ss_pred cCceeEEEeccCCC-CCCceEEecceEeecccceEEEec-----------CCceEEEecch-hhhhhhccCcCCCcccee
Confidence 1111111111 122467777776654223444444 34888888654 133445556678888876
Q ss_pred ccc-cCe-EEEEEC
Q 001655 777 NAF-NGK-LLAAIN 788 (1036)
Q Consensus 777 ~~~-~g~-Lv~~~g 788 (1036)
+-- +|. +++|.|
T Consensus 300 ~fn~~G~ifaYA~g 313 (347)
T KOG0647|consen 300 SFNRNGSIFAYALG 313 (347)
T ss_pred EecCCCCEEEEEee
Confidence 522 343 445665
No 25
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=97.40 E-value=0.073 Score=58.39 Aligned_cols=199 Identities=16% Similarity=0.118 Sum_probs=117.6
Q ss_pred ceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecC--Cc
Q 001655 530 PRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSN--KK 607 (1036)
Q Consensus 530 p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~--~~ 607 (1036)
..|+.+.+ ..+.|+++--||.+-.|++|...+.+ .....+-..|+.=-.|..+|.+.||..|.++++...+= .+
T Consensus 216 I~sv~FHp--~~plllvaG~d~~lrifqvDGk~N~~--lqS~~l~~fPi~~a~f~p~G~~~i~~s~rrky~ysyDle~ak 291 (514)
T KOG2055|consen 216 ITSVQFHP--TAPLLLVAGLDGTLRIFQVDGKVNPK--LQSIHLEKFPIQKAEFAPNGHSVIFTSGRRKYLYSYDLETAK 291 (514)
T ss_pred ceEEEecC--CCceEEEecCCCcEEEEEecCccChh--heeeeeccCccceeeecCCCceEEEecccceEEEEeeccccc
Confidence 45665543 46777777779999999998654321 12345556666544454466678888888888776652 22
Q ss_pred E-EEeeeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCC
Q 001655 608 L-LYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCA 686 (1036)
Q Consensus 608 ~-~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~ 686 (1036)
+ .+.++....=.++-.|-...+.+ ++.+.++.=.|--|....+-.+-++.+.+..+-++++.+++.+++++..
T Consensus 292 ~~k~~~~~g~e~~~~e~FeVShd~~-fia~~G~~G~I~lLhakT~eli~s~KieG~v~~~~fsSdsk~l~~~~~~----- 365 (514)
T KOG2055|consen 292 VTKLKPPYGVEEKSMERFEVSHDSN-FIAIAGNNGHIHLLHAKTKELITSFKIEGVVSDFTFSSDSKELLASGGT----- 365 (514)
T ss_pred cccccCCCCcccchhheeEecCCCC-eEEEcccCceEEeehhhhhhhhheeeeccEEeeEEEecCCcEEEEEcCC-----
Confidence 2 23343322212233332222333 5555554444555555555567778888888899999888766666532
Q ss_pred CceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe
Q 001655 687 EESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE 757 (1036)
Q Consensus 687 ~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~ 757 (1036)
+.|-++|-.+..++.++.=+-.=+.+++|. +.+..|+++|+ .+|-+-+|+..
T Consensus 366 -----GeV~v~nl~~~~~~~rf~D~G~v~gts~~~----S~ng~ylA~GS----------~~GiVNIYd~~ 417 (514)
T KOG2055|consen 366 -----GEVYVWNLRQNSCLHRFVDDGSVHGTSLCI----SLNGSYLATGS----------DSGIVNIYDGN 417 (514)
T ss_pred -----ceEEEEecCCcceEEEEeecCccceeeeee----cCCCceEEecc----------CcceEEEeccc
Confidence 356666666666665555444444455543 12356999997 45666666644
No 26
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=97.39 E-value=0.36 Score=54.63 Aligned_cols=314 Identities=15% Similarity=0.179 Sum_probs=146.0
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEEEE-eCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCC
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNVAT-ANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENP 492 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~as-~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~ 492 (1036)
..++.+++.++.+.+.++....+..+..+. -++.++.++..++.+..+++...+ .+.+.......-++++++
T Consensus 15 ~~~v~viD~~t~~~~~~i~~~~~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~~--~v~~i~~G~~~~~i~~s~----- 87 (369)
T PF02239_consen 15 SGSVAVIDGATNKVVARIPTGGAPHAGLKFSPDGRYLYVANRDGTVSVIDLATGK--VVATIKVGGNPRGIAVSP----- 87 (369)
T ss_dssp GTEEEEEETTT-SEEEEEE-STTEEEEEE-TT-SSEEEEEETTSEEEEEETTSSS--EEEEEE-SSEEEEEEE-------
T ss_pred CCEEEEEECCCCeEEEEEcCCCCceeEEEecCCCCEEEEEcCCCeEEEEECCccc--EEEEEecCCCcceEEEcC-----
Confidence 467888988876666666432211122222 236788888878888777765544 333445566677888754
Q ss_pred CcccEEEEEEecCCEEEEEECCCCCeeEEecCC---Cc-cCceeEEeeeecCeEEEEEEeCC-CcEEEEEEecCCCcccc
Q 001655 493 SYSQIAAVGMWTDISVRIFSLPDLNLITKEHLG---GE-IIPRSVLLCAFEGISYLLCALGD-GHLLNFLLNMKTGELTD 567 (1036)
Q Consensus 493 ~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~---~~-~~p~si~~~~~~~~~~L~vgl~~-G~l~~y~~~~~~~~l~~ 567 (1036)
.+.+++++.|.++.+.+++..+++++...... .+ ..++-..+.....++..++.+.+ |.+... +..+..-..
T Consensus 88 -DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vV--dy~d~~~~~ 164 (369)
T PF02239_consen 88 -DGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVV--DYSDPKNLK 164 (369)
T ss_dssp -TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEE--ETTTSSCEE
T ss_pred -CCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEE--Eeccccccc
Confidence 36789999887999999999999887543222 11 12232333333445555555554 766543 332211001
Q ss_pred ceeeecCccceEEEEEEeCCceEEEEE-cCCceEEEec--CCcEEEeeecccccee---eecccCCCCCCeEEEEe--CC
Q 001655 568 RKKVSLGTQPITLRTFSSKNTTHVFAA-SDRPTVIYSS--NKKLLYSNVNLKEVSH---MCPFNSAAFPDSLAIAK--EG 639 (1036)
Q Consensus 568 ~~~~~lG~~pv~l~~~~~~~~~~v~~~-~~~p~~i~~~--~~~~~~~~~~~~~i~~---~~~f~~~~~~~~l~~~~--~~ 639 (1036)
.+....|..|--.- + ..++..+++. .....+...+ .+++... +.....-+ .+.|.... -+-+..+ .+
T Consensus 165 ~~~i~~g~~~~D~~-~-dpdgry~~va~~~sn~i~viD~~~~k~v~~-i~~g~~p~~~~~~~~php~--~g~vw~~~~~~ 239 (369)
T PF02239_consen 165 VTTIKVGRFPHDGG-F-DPDGRYFLVAANGSNKIAVIDTKTGKLVAL-IDTGKKPHPGPGANFPHPG--FGPVWATSGLG 239 (369)
T ss_dssp EEEEE--TTEEEEE-E--TTSSEEEEEEGGGTEEEEEETTTTEEEEE-EE-SSSBEETTEEEEEETT--TEEEEEEEBSS
T ss_pred eeeecccccccccc-c-CcccceeeecccccceeEEEeeccceEEEE-eeccccccccccccccCCC--cceEEeecccc
Confidence 12333444442211 1 1122223231 1122222211 2333211 11000000 01111111 1233322 23
Q ss_pred eEEEEEEcCC-------CCe-EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 640 ELTIGTIDDI-------QKL-HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 640 ~l~i~~l~~~-------~~~-~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
...+..+... ..| .+++|++.+.|..+..||+++.+.|...-.. ....|.++|.++++.+.++...
T Consensus 240 ~~~~~~ig~~~v~v~d~~~wkvv~~I~~~G~glFi~thP~s~~vwvd~~~~~------~~~~v~viD~~tl~~~~~i~~~ 313 (369)
T PF02239_consen 240 YFAIPLIGTDPVSVHDDYAWKVVKTIPTQGGGLFIKTHPDSRYVWVDTFLNP------DADTVQVIDKKTLKVVKTITPG 313 (369)
T ss_dssp SSEEEEEE--TTT-STTTBTSEEEEEE-SSSS--EE--TT-SEEEEE-TT-S------SHT-EEEEECCGTEEEE-HHHH
T ss_pred ceecccccCCccccchhhcCeEEEEEECCCCcceeecCCCCccEEeeccCCC------CCceEEEEECcCcceeEEEecc
Confidence 3333333222 234 7899999999999999999997777632210 1458999999999887766544
Q ss_pred CCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCe
Q 001655 712 TFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGK 760 (1036)
Q Consensus 712 ~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~k 760 (1036)
++-.+ ...+|..++++.++ ..- ...|+|.+|+....+
T Consensus 314 ~~~~~---~h~ef~~dG~~v~v-S~~--------~~~~~i~v~D~~Tl~ 350 (369)
T PF02239_consen 314 PGKRV---VHMEFNPDGKEVWV-SVW--------DGNGAIVVYDAKTLK 350 (369)
T ss_dssp HT--E---EEEEE-TTSSEEEE-EEE----------TTEEEEEETTTTE
T ss_pred CCCcE---eccEECCCCCEEEE-EEe--------cCCCEEEEEECCCcE
Confidence 44333 34467666655444 211 134599999765433
No 27
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.36 E-value=0.26 Score=57.36 Aligned_cols=352 Identities=15% Similarity=0.161 Sum_probs=180.9
Q ss_pred CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEE
Q 001655 476 LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLN 555 (1036)
Q Consensus 476 l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~ 555 (1036)
-+.+++|+++.+ .+.+++.+.. +.-+++|++|..+.+-.-....+ .| ++.+.--+....|-.|-.||.+.+
T Consensus 61 d~d~ita~~l~~------d~~~L~~a~r-s~llrv~~L~tgk~irswKa~He-~P-vi~ma~~~~g~LlAtggaD~~v~V 131 (775)
T KOG0319|consen 61 DEDEITALALTP------DEEVLVTASR-SQLLRVWSLPTGKLIRSWKAIHE-AP-VITMAFDPTGTLLATGGADGRVKV 131 (775)
T ss_pred chhhhheeeecC------CccEEEEeec-cceEEEEEcccchHhHhHhhccC-CC-eEEEEEcCCCceEEeccccceEEE
Confidence 346789999865 2556666666 88999999998654321001001 12 222221122333445778999998
Q ss_pred EEEecCCCccccceeeecC-ccceEEEEEEeCCceEEEEEcCCc--eEEEec--CCcEEEeeecccc---------ceee
Q 001655 556 FLLNMKTGELTDRKKVSLG-TQPITLRTFSSKNTTHVFAASDRP--TVIYSS--NKKLLYSNVNLKE---------VSHM 621 (1036)
Q Consensus 556 y~~~~~~~~l~~~~~~~lG-~~pv~l~~~~~~~~~~v~~~~~~p--~~i~~~--~~~~~~~~~~~~~---------i~~~ 621 (1036)
+.+....+. ..+-| ..+|....| +..+ |++++. ++.....+++.+. -.++
T Consensus 132 Wdi~~~~~t-----h~fkG~gGvVssl~F-----------~~~~~~~lL~sg~~D~~v~vwnl~~~~tcl~~~~~H~S~v 195 (775)
T KOG0319|consen 132 WDIKNGYCT-----HSFKGHGGVVSSLLF-----------HPHWNRWLLASGATDGTVRVWNLNDKRTCLHTMILHKSAV 195 (775)
T ss_pred EEeeCCEEE-----EEecCCCceEEEEEe-----------CCccchhheeecCCCceEEEEEcccCchHHHHHHhhhhhe
Confidence 887654311 11112 112222222 1111 222221 2333333333111 1112
Q ss_pred ecccCCCCCCeEEEE-eCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecC-----CCEEEEEEeecCCCCCceeeEEEE
Q 001655 622 CPFNSAAFPDSLAIA-KEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQ-----SRTFAICSLKNQSCAEESEMHFVR 695 (1036)
Q Consensus 622 ~~f~~~~~~~~l~~~-~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~-----~~~~~v~~~~~~~~~~~~~~~~l~ 695 (1036)
+.+....-.+-++.. .+.-+.+-.+...+ .-+.+|+.+....+++.++ ...+..+. ..+.++
T Consensus 196 tsL~~~~d~~~~ls~~RDkvi~vwd~~~~~--~l~~lp~ye~~E~vv~l~~~~~~~~~~~~TaG----------~~g~~~ 263 (775)
T KOG0319|consen 196 TSLAFSEDSLELLSVGRDKVIIVWDLVQYK--KLKTLPLYESLESVVRLREELGGKGEYIITAG----------GSGVVQ 263 (775)
T ss_pred eeeeeccCCceEEEeccCcEEEEeehhhhh--hhheechhhheeeEEEechhcCCcceEEEEec----------CCceEE
Confidence 211111111122322 23334444442221 2366787777777777665 11222221 346899
Q ss_pred EEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEE-EecCcee
Q 001655 696 LLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEK-ETKGAVY 774 (1036)
Q Consensus 696 l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~-~~~g~v~ 774 (1036)
.+|+++++.+....-++.|++..+..+ .....+++|-+. -.|++|+.++ ++++... -.++-|+
T Consensus 264 ~~d~es~~~~~~~~~~~~~e~~~~~~~---~~~~~~l~vtae-----------Qnl~l~d~~~--l~i~k~ivG~ndEI~ 327 (775)
T KOG0319|consen 264 YWDSESGKCVYKQRQSDSEEIDHLLAI---ESMSQLLLVTAE-----------QNLFLYDEDE--LTIVKQIVGYNDEIL 327 (775)
T ss_pred EEecccchhhhhhccCCchhhhcceec---cccCceEEEEcc-----------ceEEEEEccc--cEEehhhcCCchhhe
Confidence 999999998876655556664433222 123566666542 1456665443 4444332 3577889
Q ss_pred Eecccc---CeEEEEEC-CEEEEEEeeecCCCccchhcccccccce-EEEEEE--EeCCEEEEEeccccEEEEEEeccCC
Q 001655 775 SLNAFN---GKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHI-LALYVQ--TRGDFIVVGDLMKSISLLIYKHEEG 847 (1036)
Q Consensus 775 ~i~~~~---g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~-~~~~l~--~~~~~I~vgD~~~Sv~~~~~~~~~~ 847 (1036)
.++-++ .+|++|.| ..+++|+... . .-++ +.++. .+++++ ..|.+++-|---+|+-+.|++....
T Consensus 328 Dm~~lG~e~~~laVATNs~~lr~y~~~~--~-~c~i-----i~GH~e~vlSL~~~~~g~llat~sKD~svilWr~~~~~~ 399 (775)
T KOG0319|consen 328 DMKFLGPEESHLAVATNSPELRLYTLPT--S-YCQI-----IPGHTEAVLSLDVWSSGDLLATGSKDKSVILWRLNNNCS 399 (775)
T ss_pred eeeecCCccceEEEEeCCCceEEEecCC--C-ceEE-----EeCchhheeeeeecccCcEEEEecCCceEEEEEecCCcc
Confidence 999886 68988888 5788886421 1 1111 12232 345665 4566899999999999999854444
Q ss_pred eEEEEec-cCCcceeEEEEE--eeCceEEEEccCCcEEEEeeCC
Q 001655 848 AIEERAR-DYNANWMSAVEI--LDDDIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 848 ~l~~~a~-D~~~~~~~~~~~--l~~~~~l~~D~~gnl~~l~~~~ 888 (1036)
+...++. .-+...+.++.+ +....++..-.++.+-+..++.
T Consensus 400 ~~~~~a~~~gH~~svgava~~~~~asffvsvS~D~tlK~W~l~~ 443 (775)
T KOG0319|consen 400 KSLCVAQANGHTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPK 443 (775)
T ss_pred hhhhhhhhcccccccceeeecccCccEEEEecCCceEEEecCCC
Confidence 4444442 233444555544 2222344455577777766654
No 28
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=97.29 E-value=0.025 Score=64.83 Aligned_cols=112 Identities=13% Similarity=0.275 Sum_probs=66.5
Q ss_pred cCceeEeccc--cCeE-EEEECCEEEEEEeeecCCCcc-c-hhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEec
Q 001655 770 KGAVYSLNAF--NGKL-LAAINQKIQLYKWMLRDDGTR-E-LQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 770 ~g~v~~i~~~--~g~L-v~~~g~~l~v~~~~~~~~~~~-~-L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~ 844 (1036)
++-.|.+..- -+++ .+|...+|++|+.+ .|+. | +...-...+...-+.++-.+.||...-.-+-+.++.|-.
T Consensus 596 ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~---sgKq~k~FKgs~~~eG~lIKv~lDPSgiY~atScsdktl~~~Df~s 672 (1080)
T KOG1408|consen 596 KTTLYDMAVDPTSKLVVTVCQDRNIRIFDIE---SGKQVKSFKGSRDHEGDLIKVILDPSGIYLATSCSDKTLCFVDFVS 672 (1080)
T ss_pred cceEEEeeeCCCcceEEEEecccceEEEecc---ccceeeeecccccCCCceEEEEECCCccEEEEeecCCceEEEEecc
Confidence 3444544422 2333 45677889999874 2321 1 111111122233345566688888888888888876643
Q ss_pred cCCeEEEEeccCC-cceeEEEEEeeC-ceEEEEccCCcEEEEeeCC
Q 001655 845 EEGAIEERARDYN-ANWMSAVEILDD-DIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 845 ~~~~l~~~a~D~~-~~~~~~~~~l~~-~~~l~~D~~gnl~~l~~~~ 888 (1036)
+. .+|+-+. .--||.+.|+.+ ..+|..-.+|.||+++.+.
T Consensus 673 --gE--cvA~m~GHsE~VTG~kF~nDCkHlISvsgDgCIFvW~lp~ 714 (1080)
T KOG1408|consen 673 --GE--CVAQMTGHSEAVTGVKFLNDCKHLISVSGDGCIFVWKLPL 714 (1080)
T ss_pred --ch--hhhhhcCcchheeeeeecccchhheeecCCceEEEEECch
Confidence 22 2444332 335788999876 4578888899999999763
No 29
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.25 E-value=0.69 Score=54.18 Aligned_cols=316 Identities=15% Similarity=0.185 Sum_probs=157.7
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEe-CCCcEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCAL-GDGHLLNF 556 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl-~~G~l~~y 556 (1036)
..++|.++.+ ....+++|+. +|...+|.+|++.+++.-.++. .....+.+.. ...+|-+|. +-|+|++|
T Consensus 266 ~kvtaa~fH~------~t~~lvvgFs-sG~f~LyelP~f~lih~LSis~-~~I~t~~~N~--tGDWiA~g~~klgQLlVw 335 (893)
T KOG0291|consen 266 SKVTAAAFHK------GTNLLVVGFS-SGEFGLYELPDFNLIHSLSISD-QKILTVSFNS--TGDWIAFGCSKLGQLLVW 335 (893)
T ss_pred cceeeeeccC------CceEEEEEec-CCeeEEEecCCceEEEEeeccc-ceeeEEEecc--cCCEEEEcCCccceEEEE
Confidence 4456666532 4678888887 9999999999999987655542 1222333332 246777766 45999999
Q ss_pred EEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCC-------
Q 001655 557 LLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAF------- 629 (1036)
Q Consensus 557 ~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~------- 629 (1036)
++...+--++.+ |-.+ ++..+.......++++|. ++++.+....+. -.++..|.....
T Consensus 336 eWqsEsYVlKQQ-----gH~~-~i~~l~YSpDgq~iaTG~-------eDgKVKvWn~~S--gfC~vTFteHts~Vt~v~f 400 (893)
T KOG0291|consen 336 EWQSESYVLKQQ-----GHSD-RITSLAYSPDGQLIATGA-------EDGKVKVWNTQS--GFCFVTFTEHTSGVTAVQF 400 (893)
T ss_pred Eeeccceeeecc-----cccc-ceeeEEECCCCcEEEecc-------CCCcEEEEeccC--ceEEEEeccCCCceEEEEE
Confidence 998654333321 1111 222222222222344431 245555443321 113333432221
Q ss_pred ---CCeEEEEe-CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEE
Q 001655 630 ---PDSLAIAK-EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 630 ---~~~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i 705 (1036)
++.++..+ ++.++.--+.....+-.-..|-.-+...++-+|....++.+.- ..+.|.+.+.+|++.+
T Consensus 401 ~~~g~~llssSLDGtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~---------d~F~IfvWS~qTGqll 471 (893)
T KOG0291|consen 401 TARGNVLLSSSLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQ---------DSFEIFVWSVQTGQLL 471 (893)
T ss_pred EecCCEEEEeecCCeEEeeeecccceeeeecCCCceeeeEEEEcCCCCEEEeecc---------ceEEEEEEEeecCeee
Confidence 22233222 4444444443333332222232333344555555444333332 3478888899999888
Q ss_pred EEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeE
Q 001655 706 STYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKL 783 (1036)
Q Consensus 706 ~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~L 783 (1036)
+. +.-+|-+.+-.+ |+.. ...++-|. .. -.+.+|++-..+ ..+-..++..-|+++..- +..|
T Consensus 472 Di--LsGHEgPVs~l~--f~~~-~~~LaS~S-WD---------kTVRiW~if~s~-~~vEtl~i~sdvl~vsfrPdG~el 535 (893)
T KOG0291|consen 472 DI--LSGHEGPVSGLS--FSPD-GSLLASGS-WD---------KTVRIWDIFSSS-GTVETLEIRSDVLAVSFRPDGKEL 535 (893)
T ss_pred eh--hcCCCCcceeeE--Eccc-cCeEEecc-cc---------ceEEEEEeeccC-ceeeeEeeccceeEEEEcCCCCeE
Confidence 73 455666554322 3222 23444332 11 134556554321 112233445555555533 3356
Q ss_pred EEE-ECCEEEEEEeeec-C----CCccchhc----------c-cccccceEEEEEEEeCCEEEEEeccccEEEEEEe
Q 001655 784 LAA-INQKIQLYKWMLR-D----DGTRELQS----------E-CGHHGHILALYVQTRGDFIVVGDLMKSISLLIYK 843 (1036)
Q Consensus 784 v~~-~g~~l~v~~~~~~-~----~~~~~L~~----------~-~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~ 843 (1036)
.++ ....|.+|+.++- + +|.+.+.+ . +...-++..++.+..|+.|+.|-..+++.++...
T Consensus 536 aVaTldgqItf~d~~~~~q~~~IdgrkD~~~gR~~~D~~ta~~sa~~K~Ftti~ySaDG~~IlAgG~sn~iCiY~v~ 612 (893)
T KOG0291|consen 536 AVATLDGQITFFDIKEAVQVGSIDGRKDLSGGRKETDRITAENSAKGKTFTTICYSADGKCILAGGESNSICIYDVP 612 (893)
T ss_pred EEEEecceEEEEEhhhceeeccccchhhccccccccceeehhhcccCCceEEEEEcCCCCEEEecCCcccEEEEECc
Confidence 544 4447777665310 0 12111111 1 1111223456677789999999999999987543
No 30
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=97.16 E-value=0.62 Score=51.93 Aligned_cols=337 Identities=15% Similarity=0.175 Sum_probs=166.8
Q ss_pred EEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccc
Q 001655 498 AAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQP 577 (1036)
Q Consensus 498 ~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~p 577 (1036)
+.+.+- .+.+.+|.+..-.+.-.+.+-...--.-++-+.++++--++-|-.+|.+.+|.... ..++ +....=..-
T Consensus 215 liit~G-k~H~~Fw~~~~~~l~k~~~~fek~ekk~Vl~v~F~engdviTgDS~G~i~Iw~~~~--~~~~--k~~~aH~gg 289 (626)
T KOG2106|consen 215 LIITCG-KGHLYFWTLRGGSLVKRQGIFEKREKKFVLCVTFLENGDVITGDSGGNILIWSKGT--NRIS--KQVHAHDGG 289 (626)
T ss_pred EEEEeC-CceEEEEEccCCceEEEeeccccccceEEEEEEEcCCCCEEeecCCceEEEEeCCC--ceEE--eEeeecCCc
Confidence 344433 67788887766554444443210000222223444455678888999998887532 1111 111100000
Q ss_pred e-EEEEEEeCCceEEEEEcCCce-EEEecC--CcEEEe--eeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCC
Q 001655 578 I-TLRTFSSKNTTHVFAASDRPT-VIYSSN--KKLLYS--NVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQK 651 (1036)
Q Consensus 578 v-~l~~~~~~~~~~v~~~~~~p~-~i~~~~--~~~~~~--~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~ 651 (1036)
| .|..+ .++-++.|.+-- ++.+++ .+++-. |-...++..++ ++-++.++-.+.|.+..++++....
T Consensus 290 v~~L~~l----r~GtllSGgKDRki~~Wd~~y~k~r~~elPe~~G~iRtv~----e~~~di~vGTtrN~iL~Gt~~~~f~ 361 (626)
T KOG2106|consen 290 VFSLCML----RDGTLLSGGKDRKIILWDDNYRKLRETELPEQFGPIRTVA----EGKGDILVGTTRNFILQGTLENGFT 361 (626)
T ss_pred eEEEEEe----cCccEeecCccceEEeccccccccccccCchhcCCeeEEe----cCCCcEEEeeccceEEEeeecCCce
Confidence 0 11111 122233333322 222221 111111 11112344433 2334566678899999999987543
Q ss_pred eEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceE
Q 001655 652 LHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVY 731 (1036)
Q Consensus 652 ~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~ 731 (1036)
+.+. .. ++.---++-||..+.|+-+.-. ..++|.+. -+.+.+..++. .+.|+ -|.. ...
T Consensus 362 ~~v~-gh-~delwgla~hps~~q~~T~gqd----------k~v~lW~~--~k~~wt~~~~d--~~~~~---~fhp--sg~ 420 (626)
T KOG2106|consen 362 LTVQ-GH-GDELWGLATHPSKNQLLTCGQD----------KHVRLWND--HKLEWTKIIED--PAECA---DFHP--SGV 420 (626)
T ss_pred EEEE-ec-ccceeeEEcCCChhheeeccCc----------ceEEEccC--CceeEEEEecC--ceeEe---eccC--cce
Confidence 3221 11 1222345667777766655432 35777762 33444433332 22232 2322 238
Q ss_pred EEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeEEEE-ECCEEEEEEeeecCCCccchhc
Q 001655 732 YCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKLLAA-INQKIQLYKWMLRDDGTRELQS 808 (1036)
Q Consensus 732 i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~Lv~~-~g~~l~v~~~~~~~~~~~~L~~ 808 (1036)
+++|| ..||.+++++.+..+-.++.. ..|..++..- ..+|.++ -++.|++|..+. +..++.+
T Consensus 421 va~Gt----------~~G~w~V~d~e~~~lv~~~~d--~~~ls~v~ysp~G~~lAvgs~d~~iyiy~Vs~---~g~~y~r 485 (626)
T KOG2106|consen 421 VAVGT----------ATGRWFVLDTETQDLVTIHTD--NEQLSVVRYSPDGAFLAVGSHDNHIYIYRVSA---NGRKYSR 485 (626)
T ss_pred EEEee----------ccceEEEEecccceeEEEEec--CCceEEEEEcCCCCEEEEecCCCeEEEEEECC---CCcEEEE
Confidence 99999 569999999988666666655 5566555533 3466554 447899999853 2344444
Q ss_pred ccccccceEEEEEEEe--CCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEee-------C----------
Q 001655 809 ECGHHGHILALYVQTR--GDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILD-------D---------- 869 (1036)
Q Consensus 809 ~~~~~~~~~~~~l~~~--~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~-------~---------- 869 (1036)
...... .++++|++. ++++ ++-.-+ .-++-|.+..-+..--.||. .|.+..+.|. +
T Consensus 486 ~~k~~g-s~ithLDwS~Ds~~~-~~~S~d-~eiLyW~~~~~~~~ts~kDv--kW~t~~c~lGF~v~g~s~~t~i~a~~rs 560 (626)
T KOG2106|consen 486 VGKCSG-SPITHLDWSSDSQFL-VSNSGD-YEILYWKPSECKQITSVKDV--KWATYTCTLGFEVFGGSDGTDINAVARS 560 (626)
T ss_pred eeeecC-ceeEEeeecCCCceE-EeccCc-eEEEEEccccCcccceecce--eeeeeEEEEEEEEecccCCchHHHhhhh
Confidence 322233 566777653 3444 332222 22444554332222224443 3555433331 1
Q ss_pred ---ceEEEEccCCcEEEEeeCC
Q 001655 870 ---DIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 870 ---~~~l~~D~~gnl~~l~~~~ 888 (1036)
+....+|.+|.+++|+|+-
T Consensus 561 ~~~~~lA~gdd~g~v~lf~yPc 582 (626)
T KOG2106|consen 561 HCEKLLASGDDFGKVHLFSYPC 582 (626)
T ss_pred hhhhhhhccccCceEEEEcccc
Confidence 1256789999999999874
No 31
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=97.09 E-value=0.24 Score=59.13 Aligned_cols=74 Identities=22% Similarity=0.248 Sum_probs=61.2
Q ss_pred CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 661 EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 661 ~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
+-..+++++|....+++.+.+. +|++++.++|+....+..+..+...|...|. ....||+-||
T Consensus 189 ~i~~~~aW~Pk~g~la~~~~d~----------~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~ws---PnG~YiAAs~---- 251 (933)
T KOG1274|consen 189 RICTRLAWHPKGGTLAVPPVDN----------TVKVYSRKGWELQFKLRDKLSSSKFSDLQWS---PNGKYIAAST---- 251 (933)
T ss_pred ceeeeeeecCCCCeEEeeccCC----------eEEEEccCCceeheeecccccccceEEEEEc---CCCcEEeeec----
Confidence 3446789999999999999874 8999999999999888888888877776764 2468999887
Q ss_pred CCCCCCcceEEEEEEEe
Q 001655 741 PEENEPTKGRILVFIVE 757 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~ 757 (1036)
..|.|.||+++
T Consensus 252 ------~~g~I~vWnv~ 262 (933)
T KOG1274|consen 252 ------LDGQILVWNVD 262 (933)
T ss_pred ------cCCcEEEEecc
Confidence 56889999987
No 32
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=97.06 E-value=0.29 Score=54.29 Aligned_cols=272 Identities=14% Similarity=0.140 Sum_probs=154.2
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEE-ecCCCccCceeEEeeeecCeEEEEEEeCCCcEEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITK-EHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLN 555 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~-~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~ 555 (1036)
...|++++++|.. ...++|++ +-.+.||+....+..-. .... -...|+.+-. +...|.+|-..|.+-.
T Consensus 26 ~~~vssl~fsp~~-----P~d~aVt~--S~rvqly~~~~~~~~k~~srFk--~~v~s~~fR~--DG~LlaaGD~sG~V~v 94 (487)
T KOG0310|consen 26 HNSVSSLCFSPKH-----PYDFAVTS--SVRVQLYSSVTRSVRKTFSRFK--DVVYSVDFRS--DGRLLAAGDESGHVKV 94 (487)
T ss_pred cCcceeEecCCCC-----CCceEEec--ccEEEEEecchhhhhhhHHhhc--cceeEEEeec--CCeEEEccCCcCcEEE
Confidence 3567888887643 23344432 45789998766443211 0111 1223443332 3456777889999988
Q ss_pred EEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEc-CCceEEEec-CCcEEEeeecc--ccceeeecccCCCCCC
Q 001655 556 FLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAAS-DRPTVIYSS-NKKLLYSNVNL--KEVSHMCPFNSAAFPD 631 (1036)
Q Consensus 556 y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~-~~p~~i~~~-~~~~~~~~~~~--~~i~~~~~f~~~~~~~ 631 (1036)
|...+. ..| +...--..|++.+.|...+ +.+|+.| |....-+++ .+......+.. +-+.+.. +. ...+
T Consensus 95 fD~k~r-~iL---R~~~ah~apv~~~~f~~~d-~t~l~s~sDd~v~k~~d~s~a~v~~~l~~htDYVR~g~-~~--~~~~ 166 (487)
T KOG0310|consen 95 FDMKSR-VIL---RQLYAHQAPVHVTKFSPQD-NTMLVSGSDDKVVKYWDLSTAYVQAELSGHTDYVRCGD-IS--PAND 166 (487)
T ss_pred eccccH-HHH---HHHhhccCceeEEEecccC-CeEEEecCCCceEEEEEcCCcEEEEEecCCcceeEeec-cc--cCCC
Confidence 874321 011 2233456788888775433 3455544 433333443 22222112221 2222221 11 1112
Q ss_pred eEEEEe--CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE
Q 001655 632 SLAIAK--EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP 709 (1036)
Q Consensus 632 ~l~~~~--~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~ 709 (1036)
.+++.- ++.+++--.-... -.+..+.=|.....++|.|....++-+.- +.+++.|-.++..+-.-.
T Consensus 167 hivvtGsYDg~vrl~DtR~~~-~~v~elnhg~pVe~vl~lpsgs~iasAgG-----------n~vkVWDl~~G~qll~~~ 234 (487)
T KOG0310|consen 167 HIVVTGSYDGKVRLWDTRSLT-SRVVELNHGCPVESVLALPSGSLIASAGG-----------NSVKVWDLTTGGQLLTSM 234 (487)
T ss_pred eEEEecCCCceEEEEEeccCC-ceeEEecCCCceeeEEEcCCCCEEEEcCC-----------CeEEEEEecCCceehhhh
Confidence 333332 4556555444332 34556666778899999998776665543 478999876444333333
Q ss_pred CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc--CeEEEEE
Q 001655 710 LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN--GKLLAAI 787 (1036)
Q Consensus 710 ~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~--g~Lv~~~ 787 (1036)
+..+-.++|++... ++..++-.| --|++.+|++.+ ++++|...++|||.+|.-.. ..+++|+
T Consensus 235 ~~H~KtVTcL~l~s---~~~rLlS~s-----------LD~~VKVfd~t~--~Kvv~s~~~~~pvLsiavs~dd~t~viGm 298 (487)
T KOG0310|consen 235 FNHNKTVTCLRLAS---DSTRLLSGS-----------LDRHVKVFDTTN--YKVVHSWKYPGPVLSIAVSPDDQTVVIGM 298 (487)
T ss_pred hcccceEEEEEeec---CCceEeecc-----------cccceEEEEccc--eEEEEeeecccceeeEEecCCCceEEEec
Confidence 44677888886643 334444333 347999998654 77899999999999999875 4789999
Q ss_pred CCEEEEEE
Q 001655 788 NQKIQLYK 795 (1036)
Q Consensus 788 g~~l~v~~ 795 (1036)
++-+..+.
T Consensus 299 snGlv~~r 306 (487)
T KOG0310|consen 299 SNGLVSIR 306 (487)
T ss_pred ccceeeee
Confidence 88776554
No 33
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=96.80 E-value=0.19 Score=52.63 Aligned_cols=206 Identities=16% Similarity=0.213 Sum_probs=104.9
Q ss_pred EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE-EECCCCCeEeEEEEEEEcCCCceE
Q 001655 653 HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST-YPLDTFEYGCSILSCSFSDDSNVY 731 (1036)
Q Consensus 653 ~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~-~~~~~~E~v~si~~~~l~~~~~~~ 731 (1036)
+.++|.+....-...|||...--+|++.-. +...+.-+++..-..+.. -+-+.++...+ .+-+...+|
T Consensus 99 ~l~rirf~spv~~~q~hp~k~n~~va~~~~-------~sp~vi~~s~~~h~~Lp~d~d~dln~sas~----~~fdr~g~y 167 (405)
T KOG1273|consen 99 PLKRIRFDSPVWGAQWHPRKRNKCVATIME-------ESPVVIDFSDPKHSVLPKDDDGDLNSSASH----GVFDRRGKY 167 (405)
T ss_pred ceeEEEccCccceeeeccccCCeEEEEEec-------CCcEEEEecCCceeeccCCCcccccccccc----ccccCCCCE
Confidence 456666666667777787666666666432 112333333211111110 01111222211 122334689
Q ss_pred EEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc----cC-eEEE-EECCEEEEEEeeecC----C
Q 001655 732 YCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF----NG-KLLA-AINQKIQLYKWMLRD----D 801 (1036)
Q Consensus 732 i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~----~g-~Lv~-~~g~~l~v~~~~~~~----~ 801 (1036)
|++|| .+|.+++|+.. .++.+++..+.. +++|.++ +| +|++ +....|+.|+..+-+ +
T Consensus 168 IitGt----------sKGkllv~~a~--t~e~vas~rits-~~~IK~I~~s~~g~~liiNtsDRvIR~ye~~di~~~~r~ 234 (405)
T KOG1273|consen 168 IITGT----------SKGKLLVYDAE--TLECVASFRITS-VQAIKQIIVSRKGRFLIINTSDRVIRTYEISDIDDEGRD 234 (405)
T ss_pred EEEec----------CcceEEEEecc--hheeeeeeeech-heeeeEEEEeccCcEEEEecCCceEEEEehhhhcccCcc
Confidence 99999 56999999864 456677666544 5555544 55 4444 444567888865211 1
Q ss_pred Cc----cch---hcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEE
Q 001655 802 GT----REL---QSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLG 874 (1036)
Q Consensus 802 ~~----~~L---~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~ 874 (1036)
+. .|+ +.+..|. -.+.+-.|.||++|. .+.-.+|-|...-+.|+.+-.-...-....+.-=-...+++
T Consensus 235 ~e~e~~~K~qDvVNk~~Wk----~ccfs~dgeYv~a~s-~~aHaLYIWE~~~GsLVKILhG~kgE~l~DV~whp~rp~i~ 309 (405)
T KOG1273|consen 235 GEVEPEHKLQDVVNKLQWK----KCCFSGDGEYVCAGS-ARAHALYIWEKSIGSLVKILHGTKGEELLDVNWHPVRPIIA 309 (405)
T ss_pred CCcChhHHHHHHHhhhhhh----heeecCCccEEEecc-ccceeEEEEecCCcceeeeecCCchhheeecccccceeeee
Confidence 11 122 2222222 122334678998888 44456777877777776553222211111110000023666
Q ss_pred EccCCcEEEEeeC
Q 001655 875 AENNFNLFTVRKN 887 (1036)
Q Consensus 875 ~D~~gnl~~l~~~ 887 (1036)
+-..|++++....
T Consensus 310 si~sg~v~iw~~~ 322 (405)
T KOG1273|consen 310 SIASGVVYIWAVV 322 (405)
T ss_pred eccCCceEEEEee
Confidence 6688998887654
No 34
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=96.74 E-value=0.13 Score=56.55 Aligned_cols=127 Identities=13% Similarity=0.197 Sum_probs=66.7
Q ss_pred cCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEE-EEEcCcEEEEEEec-cCCc-eeEEEEcCCCCCCCCccc
Q 001655 422 STSRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVY-LEIGDGILTEVKHA-QLEY-EISCLDINPIGENPSYSQ 496 (1036)
Q Consensus 422 ~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~-l~~~~~~l~~~~~~-~l~~-~is~l~~~~~~~~~~~~~ 496 (1036)
++...+++.... .+.+|..|.+. +...+++.+.....| +++...++..+.+. ..+. -+-.+.+++ .+.
T Consensus 244 Gk~N~~lqS~~l-~~fPi~~a~f~p~G~~~i~~s~rrky~ysyDle~ak~~k~~~~~g~e~~~~e~FeVSh------d~~ 316 (514)
T KOG2055|consen 244 GKVNPKLQSIHL-EKFPIQKAEFAPNGHSVIFTSGRRKYLYSYDLETAKVTKLKPPYGVEEKSMERFEVSH------DSN 316 (514)
T ss_pred CccChhheeeee-ccCccceeeecCCCceEEEecccceEEEEeeccccccccccCCCCcccchhheeEecC------CCC
Confidence 333334444433 23467777754 444555544444333 34433444444321 1111 111333333 145
Q ss_pred EEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEec
Q 001655 497 IAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 497 ~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
++++.-- +|.|+++...+.+.+.+..+. ....++.+. .+...|++..++|.++++.+..
T Consensus 317 fia~~G~-~G~I~lLhakT~eli~s~Kie--G~v~~~~fs--Sdsk~l~~~~~~GeV~v~nl~~ 375 (514)
T KOG2055|consen 317 FIAIAGN-NGHIHLLHAKTKELITSFKIE--GVVSDFTFS--SDSKELLASGGTGEVYVWNLRQ 375 (514)
T ss_pred eEEEccc-CceEEeehhhhhhhhheeeec--cEEeeEEEe--cCCcEEEEEcCCceEEEEecCC
Confidence 6666555 788999887777766554443 233444443 2346678888899888887654
No 35
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=96.59 E-value=1.4 Score=47.46 Aligned_cols=120 Identities=18% Similarity=0.246 Sum_probs=68.8
Q ss_pred cceEEEEEEEeC--CeEEEEEE-----EEecCce--eEeccc-cCeEEEEEC---CEEEEEEeeecCCCccchhcccccc
Q 001655 747 TKGRILVFIVED--GKLQLIAE-----KETKGAV--YSLNAF-NGKLLAAIN---QKIQLYKWMLRDDGTRELQSECGHH 813 (1036)
Q Consensus 747 ~~Gri~v~~i~~--~kl~~~~~-----~~~~g~v--~~i~~~-~g~Lv~~~g---~~l~v~~~~~~~~~~~~L~~~~~~~ 813 (1036)
-.++|.+|++++ ++++.+-. .++.|.. -+|.-- +|+.+.+.+ +.|.+|.+++. .|..++.......
T Consensus 211 L~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGrFLYasNRg~dsI~~f~V~~~-~g~L~~~~~~~te 289 (346)
T COG2706 211 LNSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGRFLYASNRGHDSIAVFSVDPD-GGKLELVGITPTE 289 (346)
T ss_pred cCCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCCEEEEecCCCCeEEEEEEcCC-CCEEEEEEEeccC
Confidence 356888998885 56654432 2344433 233322 677666666 46788888532 2333332211111
Q ss_pred cc-eEEEEEEEeCCEEEE-EeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEe
Q 001655 814 GH-ILALYVQTRGDFIVV-GDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEIL 867 (1036)
Q Consensus 814 ~~-~~~~~l~~~~~~I~v-gD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l 867 (1036)
.. +--..+...++++++ +--.+.+.+++-+++.++|.++.+|...-.-+++.|+
T Consensus 290 g~~PR~F~i~~~g~~Liaa~q~sd~i~vf~~d~~TG~L~~~~~~~~~p~Pvcv~f~ 345 (346)
T COG2706 290 GQFPRDFNINPSGRFLIAANQKSDNITVFERDKETGRLTLLGRYAVVPEPVCVKFL 345 (346)
T ss_pred CcCCccceeCCCCCEEEEEccCCCcEEEEEEcCCCceEEecccccCCCCcEEEEEc
Confidence 11 111234455665554 5555668888888899999999998766555666553
No 36
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=96.58 E-value=0.42 Score=48.58 Aligned_cols=221 Identities=15% Similarity=0.143 Sum_probs=123.4
Q ss_pred EeCCeEEEEEEcCCCCeEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCC
Q 001655 636 AKEGELTIGTIDDIQKLHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFE 714 (1036)
Q Consensus 636 ~~~~~l~i~~l~~~~~~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E 714 (1036)
+..-.+++..+.+.+.-++.++... .....+.|+.+.+...-.. +-+.+|+.|-.+-.. .-+|+.+-
T Consensus 58 a~~qhvRlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgs----------eDgt~kIWdlR~~~~--qR~~~~~s 125 (311)
T KOG0315|consen 58 AGNQHVRLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGS----------EDGTVKIWDLRSLSC--QRNYQHNS 125 (311)
T ss_pred ccCCeeEEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecC----------CCceEEEEeccCccc--chhccCCC
Confidence 3455667777766655566655543 3444455554444333221 225788887765322 22344445
Q ss_pred eEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEECCEEEE
Q 001655 715 YGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAINQKIQL 793 (1036)
Q Consensus 715 ~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g~~l~v 793 (1036)
.++++.. . .++.-+++|+ -+|+|.+|++.++...-.---+..-++.++... +|..++|++++=..
T Consensus 126 pVn~vvl---h-pnQteLis~d----------qsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~c 191 (311)
T KOG0315|consen 126 PVNTVVL---H-PNQTELISGD----------QSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNC 191 (311)
T ss_pred CcceEEe---c-CCcceEEeec----------CCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccE
Confidence 5555432 2 2455677786 579999999987643321112334677777755 67777777765444
Q ss_pred EEeeec-CCCccchhcccccccc-eEEEE--EEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeC
Q 001655 794 YKWMLR-DDGTRELQSECGHHGH-ILALY--VQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDD 869 (1036)
Q Consensus 794 ~~~~~~-~~~~~~L~~~~~~~~~-~~~~~--l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~ 869 (1036)
|-|+.. ..+..+|.++-.++.+ .++++ ++..+.++...-+-+-+.++ +.++--..+..-+-..||+-.|.|-.+
T Consensus 192 yvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd~k~lat~ssdktv~iw--n~~~~~kle~~l~gh~rWvWdc~FS~d 269 (311)
T KOG0315|consen 192 YVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPDVKYLATCSSDKTVKIW--NTDDFFKLELVLTGHQRWVWDCAFSAD 269 (311)
T ss_pred EEEEccCCCccccceEhhheecccceEEEEEECCCCcEEEeecCCceEEEE--ecCCceeeEEEeecCCceEEeeeeccC
Confidence 444322 1223345554434433 24443 33345577777777777664 444442333444566799999999888
Q ss_pred ceEEEEc-cCCcEEEE
Q 001655 870 DIYLGAE-NNFNLFTV 884 (1036)
Q Consensus 870 ~~~l~~D-~~gnl~~l 884 (1036)
+.+|++- .++-....
T Consensus 270 g~YlvTassd~~~rlW 285 (311)
T KOG0315|consen 270 GEYLVTASSDHTARLW 285 (311)
T ss_pred ccEEEecCCCCceeec
Confidence 8776643 34443333
No 37
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=96.54 E-value=1.5 Score=47.12 Aligned_cols=312 Identities=13% Similarity=0.143 Sum_probs=146.6
Q ss_pred cEEEEEeCCCEEEEEEcC--CeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 438 SVNVATANASQVLLATGG--GHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 438 ~I~~as~~~~~vvv~~~~--~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
++-+.+.+++.=+++..+ ..-.+.++..+.+. .....-...|+|++++. .+.+++-|- .+|.+.|+...+
T Consensus 66 svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~-~eltgHKDSVt~~~Fsh------dgtlLATGd-msG~v~v~~~st 137 (399)
T KOG0296|consen 66 SVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFA-GELTGHKDSVTCCSFSH------DGTLLATGD-MSGKVLVFKVST 137 (399)
T ss_pred ceEEEEeCCCCceEEecCCCceEEEEEccCCcce-eEecCCCCceEEEEEcc------CceEEEecC-CCccEEEEEccc
Confidence 455666665443444433 22333455544311 11123345789998853 255666554 489999999876
Q ss_pred CCeeEEecCCCccCceeEEeeeec-CeEEEEEEeCCCcEEEEEEecCCCccccceeeecC-ccceEEEEEEeCCceEEEE
Q 001655 516 LNLITKEHLGGEIIPRSVLLCAFE-GISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLG-TQPITLRTFSSKNTTHVFA 593 (1036)
Q Consensus 516 l~~v~~~~l~~~~~p~si~~~~~~-~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG-~~pv~l~~~~~~~~~~v~~ 593 (1036)
-...+...- ....|.-.... ....|+.|..||.+..|++.... . -.+.-| ..|+.--.|. ..+..++.
T Consensus 138 g~~~~~~~~----e~~dieWl~WHp~a~illAG~~DGsvWmw~ip~~~----~-~kv~~Gh~~~ct~G~f~-pdGKr~~t 207 (399)
T KOG0296|consen 138 GGEQWKLDQ----EVEDIEWLKWHPRAHILLAGSTDGSVWMWQIPSQA----L-CKVMSGHNSPCTCGEFI-PDGKRILT 207 (399)
T ss_pred CceEEEeec----ccCceEEEEecccccEEEeecCCCcEEEEECCCcc----e-eeEecCCCCCccccccc-CCCceEEE
Confidence 433322110 11233323333 24568999999999999987531 1 112223 2333322221 12233333
Q ss_pred EcCCceEEEec-CCcEEEeeeccc--------cceeeecccCCCCCCe-EEEE--eCCeEEEEEEcCCCCeEEEEEeCCC
Q 001655 594 ASDRPTVIYSS-NKKLLYSNVNLK--------EVSHMCPFNSAAFPDS-LAIA--KEGELTIGTIDDIQKLHIRSIPLGE 661 (1036)
Q Consensus 594 ~~~~p~~i~~~-~~~~~~~~~~~~--------~i~~~~~f~~~~~~~~-l~~~--~~~~l~i~~l~~~~~~~~~~i~l~~ 661 (1036)
..+.-.++.+. +..-.+..++.. .+......-.....++ +.++ ..+.+..|..++...+....=...+
T Consensus 208 gy~dgti~~Wn~ktg~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~e 287 (399)
T KOG0296|consen 208 GYDDGTIIVWNPKTGQPLHKITQAEGLELPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDE 287 (399)
T ss_pred EecCceEEEEecCCCceeEEecccccCcCCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhh
Confidence 33333333222 211111111100 0000000000011122 1122 2344444443322222111112222
Q ss_pred ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCC
Q 001655 662 HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLP 741 (1036)
Q Consensus 662 tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~ 741 (1036)
....+.......++|++... +.|-++|-.+++.-...+.+.. |+.+ .+. +..|++-++
T Consensus 288 sve~~~~ss~lpL~A~G~vd----------G~i~iyD~a~~~~R~~c~he~~--V~~l---~w~--~t~~l~t~c----- 345 (399)
T KOG0296|consen 288 SVESIPSSSKLPLAACGSVD----------GTIAIYDLAASTLRHICEHEDG--VTKL---KWL--NTDYLLTAC----- 345 (399)
T ss_pred hhhhcccccccchhhccccc----------ceEEEEecccchhheeccCCCc--eEEE---EEc--Ccchheeec-----
Confidence 33333334444455555443 5788899877765544444433 4433 222 367888776
Q ss_pred CCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEEC--CEEEEEE
Q 001655 742 EENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAIN--QKIQLYK 795 (1036)
Q Consensus 742 ~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g--~~l~v~~ 795 (1036)
..|.++.|+..-++++..+ .-+..+|++++-- ++++++.++ ++..+|+
T Consensus 346 -----~~g~v~~wDaRtG~l~~~y-~GH~~~Il~f~ls~~~~~vvT~s~D~~a~VF~ 396 (399)
T KOG0296|consen 346 -----ANGKVRQWDARTGQLKFTY-TGHQMGILDFALSPQKRLVVTVSDDNTALVFE 396 (399)
T ss_pred -----cCceEEeeeccccceEEEE-ecCchheeEEEEcCCCcEEEEecCCCeEEEEe
Confidence 4689999999877776554 3455677766644 455555444 5566665
No 38
>PLN00181 protein SPA1-RELATED; Provisional
Probab=96.48 E-value=0.7 Score=58.62 Aligned_cols=200 Identities=14% Similarity=0.127 Sum_probs=114.1
Q ss_pred ccceEEEecC-CCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 662 HPRRICHQEQ-SRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 662 tp~~i~y~~~-~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
....+.++|. .+.++.++.+ +.+++.|..+++.+..+.. ...+.|+ .+......++++|+
T Consensus 577 ~V~~l~~~p~~~~~L~Sgs~D----------g~v~iWd~~~~~~~~~~~~--~~~v~~v---~~~~~~g~~latgs---- 637 (793)
T PLN00181 577 RVWSIDYSSADPTLLASGSDD----------GSVKLWSINQGVSIGTIKT--KANICCV---QFPSESGRSLAFGS---- 637 (793)
T ss_pred CEEEEEEcCCCCCEEEEEcCC----------CEEEEEECCCCcEEEEEec--CCCeEEE---EEeCCCCCEEEEEe----
Confidence 4567888864 3444444332 5799999888887776653 2344443 34334467788886
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCe-EEEE-ECCEEEEEEeeecCC--Cccchhcccccccce
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGK-LLAA-INQKIQLYKWMLRDD--GTRELQSECGHHGHI 816 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~-Lv~~-~g~~l~v~~~~~~~~--~~~~L~~~~~~~~~~ 816 (1036)
..|.|++|++.+.+..+.......++|+++.-.++. |+.+ ...+|.+|++..... ....+.....+....
T Consensus 638 ------~dg~I~iwD~~~~~~~~~~~~~h~~~V~~v~f~~~~~lvs~s~D~~ikiWd~~~~~~~~~~~~l~~~~gh~~~i 711 (793)
T PLN00181 638 ------ADHKVYYYDLRNPKLPLCTMIGHSKTVSYVRFVDSSTLVSSSTDNTLKLWDLSMSISGINETPLHSFMGHTNVK 711 (793)
T ss_pred ------CCCeEEEEECCCCCccceEecCCCCCEEEEEEeCCCEEEEEECCCEEEEEeCCCCccccCCcceEEEcCCCCCe
Confidence 347999999876543222223566789888766654 4433 346788877632100 001111111122222
Q ss_pred EEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEE----------EeccCCcceeEEEEEeeCc-eEEEEccCCcEEEEe
Q 001655 817 LALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEE----------RARDYNANWMSAVEILDDD-IYLGAENNFNLFTVR 885 (1036)
Q Consensus 817 ~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~----------~a~D~~~~~~~~~~~l~~~-~~l~~D~~gnl~~l~ 885 (1036)
..+.+...+++|++|..-..+.++........+.. ..-+....++.++++-.++ .+++++.+|+|.+++
T Consensus 712 ~~v~~s~~~~~lasgs~D~~v~iw~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~V~~v~ws~~~~~lva~~~dG~I~i~~ 791 (793)
T PLN00181 712 NFVGLSVSDGYIATGSETNEVFVYHKAFPMPVLSYKFKTIDPVSGLEVDDASQFISSVCWRGQSSTLVAANSTGNIKILE 791 (793)
T ss_pred eEEEEcCCCCEEEEEeCCCEEEEEECCCCCceEEEecccCCcccccccCCCCcEEEEEEEcCCCCeEEEecCCCcEEEEe
Confidence 34555556789999998888877543211111100 0012233456777665443 578888999999987
Q ss_pred e
Q 001655 886 K 886 (1036)
Q Consensus 886 ~ 886 (1036)
.
T Consensus 792 ~ 792 (793)
T PLN00181 792 M 792 (793)
T ss_pred c
Confidence 4
No 39
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=96.43 E-value=2.1 Score=47.59 Aligned_cols=263 Identities=11% Similarity=0.074 Sum_probs=130.9
Q ss_pred CcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEc----------CCeEEEEEEcCcEEEEEEeccCCce-----
Q 001655 415 GSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATG----------GGHLVYLEIGDGILTEVKHAQLEYE----- 479 (1036)
Q Consensus 415 ~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~----------~~~~~~l~~~~~~l~~~~~~~l~~~----- 479 (1036)
+.|.++|.++.+.+..+.....-... .+-++..+.++.. ...+..++. ..+..+.+.+++..
T Consensus 27 ~~v~ViD~~~~~v~g~i~~G~~P~~~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~--~t~~~~~~i~~p~~p~~~~ 103 (352)
T TIGR02658 27 TQVYTIDGEAGRVLGMTDGGFLPNPV-VASDGSFFAHASTVYSRIARGKRTDYVEVIDP--QTHLPIADIELPEGPRFLV 103 (352)
T ss_pred ceEEEEECCCCEEEEEEEccCCCcee-ECCCCCEEEEEeccccccccCCCCCEEEEEEC--ccCcEEeEEccCCCchhhc
Confidence 56777777765555555421111121 4445566666665 234444443 33444444444222
Q ss_pred ---eEEEEcCCCCCCCCcccEEEEEEec-CCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEE
Q 001655 480 ---ISCLDINPIGENPSYSQIAAVGMWT-DISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLN 555 (1036)
Q Consensus 480 ---is~l~~~~~~~~~~~~~~~~vg~w~-~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~ 555 (1036)
...+++++ .+.++.|.-+. ++++.++++..-+.+..-..+. + ...+..-+....++ ..||.+..
T Consensus 104 ~~~~~~~~ls~------dgk~l~V~n~~p~~~V~VvD~~~~kvv~ei~vp~---~-~~vy~t~e~~~~~~--~~Dg~~~~ 171 (352)
T TIGR02658 104 GTYPWMTSLTP------DNKTLLFYQFSPSPAVGVVDLEGKAFVRMMDVPD---C-YHIFPTANDTFFMH--CRDGSLAK 171 (352)
T ss_pred cCccceEEECC------CCCEEEEecCCCCCEEEEEECCCCcEEEEEeCCC---C-cEEEEecCCccEEE--eecCceEE
Confidence 12444543 36788888876 7899999998877765544431 1 11222222333333 46999999
Q ss_pred EEEecCCCccccceeeec--C------ccceEEEEEEeCCceEEEEEcCCceEEEe-cCCcEEEeeeccccceeeecccC
Q 001655 556 FLLNMKTGELTDRKKVSL--G------TQPITLRTFSSKNTTHVFAASDRPTVIYS-SNKKLLYSNVNLKEVSHMCPFNS 626 (1036)
Q Consensus 556 y~~~~~~~~l~~~~~~~l--G------~~pv~l~~~~~~~~~~v~~~~~~p~~i~~-~~~~~~~~~~~~~~i~~~~~f~~ 626 (1036)
+.++.... .. .+...+ + .+| . +...++..+|++.+....+.. ......+. . ......+..
T Consensus 172 v~~d~~g~-~~-~~~~~vf~~~~~~v~~rP-~---~~~~dg~~~~vs~eG~V~~id~~~~~~~~~----~-~~~~~~~~~ 240 (352)
T TIGR02658 172 VGYGTKGN-PK-IKPTEVFHPEDEYLINHP-A---YSNKSGRLVWPTYTGKIFQIDLSSGDAKFL----P-AIEAFTEAE 240 (352)
T ss_pred EEecCCCc-eE-EeeeeeecCCccccccCC-c---eEcCCCcEEEEecCCeEEEEecCCCcceec----c-eeeeccccc
Confidence 88876533 11 112111 3 444 1 111123455555442221111 11111000 0 000000100
Q ss_pred C--C-CCCe---EEEE-eCCeE-----------------EEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeec
Q 001655 627 A--A-FPDS---LAIA-KEGEL-----------------TIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKN 682 (1036)
Q Consensus 627 ~--~-~~~~---l~~~-~~~~l-----------------~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~ 682 (1036)
. . -|.+ +.+. +++.+ .+.-+|....-.+++|+++..|..|+++++.+..+..+.+.
T Consensus 241 ~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~kvi~~i~vG~~~~~iavS~Dgkp~lyvtn~~ 320 (352)
T TIGR02658 241 KADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAKTGKRLRKIELGHEIDSINVSQDAKPLLYALSTG 320 (352)
T ss_pred cccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECCCCeEEEEEeCCCceeeEEECCCCCeEEEEeCCC
Confidence 0 0 0111 1111 12222 34445555556789999999999999999988444444321
Q ss_pred CCCCCceeeEEEEEEeCCCceEEEEE-ECC
Q 001655 683 QSCAEESEMHFVRLLDDQTFEFISTY-PLD 711 (1036)
Q Consensus 683 ~~~~~~~~~~~l~l~d~~t~~~i~~~-~~~ 711 (1036)
...|.++|..+.+.+.++ .+.
T Consensus 321 --------s~~VsViD~~t~k~i~~i~~vg 342 (352)
T TIGR02658 321 --------DKTLYIFDAETGKELSSVNQLG 342 (352)
T ss_pred --------CCcEEEEECcCCeEEeeeccCC
Confidence 246889999999888776 443
No 40
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=96.34 E-value=2.1 Score=46.61 Aligned_cols=258 Identities=15% Similarity=0.156 Sum_probs=126.1
Q ss_pred ecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEE-EEEeCCCcEEEEEEecCCCccccceeeecCccceEEE
Q 001655 503 WTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYL-LCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLR 581 (1036)
Q Consensus 503 w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L-~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~ 581 (1036)
-.++.+.+|++.+.+.+...... ..|.++.+.. +...+ +++..+|.+..|.... +.+ .+....+..+..+
T Consensus 8 ~~d~~v~~~d~~t~~~~~~~~~~--~~~~~l~~~~--dg~~l~~~~~~~~~v~~~d~~~--~~~--~~~~~~~~~~~~~- 78 (300)
T TIGR03866 8 EKDNTISVIDTATLEVTRTFPVG--QRPRGITLSK--DGKLLYVCASDSDTIQVIDLAT--GEV--IGTLPSGPDPELF- 78 (300)
T ss_pred cCCCEEEEEECCCCceEEEEECC--CCCCceEECC--CCCEEEEEECCCCeEEEEECCC--CcE--EEeccCCCCccEE-
Confidence 33899999999876654433222 2355554432 23345 4566788888877543 221 1122223333222
Q ss_pred EEEeCCceEEEEEcC--CceEEEecC-CcE-EEeeeccccceeeecccCCCCCC--eEEEEeCCeEEEEEEcCCCCeEEE
Q 001655 582 TFSSKNTTHVFAASD--RPTVIYSSN-KKL-LYSNVNLKEVSHMCPFNSAAFPD--SLAIAKEGELTIGTIDDIQKLHIR 655 (1036)
Q Consensus 582 ~~~~~~~~~v~~~~~--~p~~i~~~~-~~~-~~~~~~~~~i~~~~~f~~~~~~~--~l~~~~~~~l~i~~l~~~~~~~~~ 655 (1036)
.+. .+.+.+++++. ....++.-. ++. ...+.. ....+ ..| .|+ .++....+.-.+..++.......+
T Consensus 79 ~~~-~~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~~-~~~~~-~~~----~~dg~~l~~~~~~~~~~~~~d~~~~~~~~ 151 (300)
T TIGR03866 79 ALH-PNGKILYIANEDDNLVTVIDIETRKVLAEIPVG-VEPEG-MAV----SPDGKIVVNTSETTNMAHFIDTKTYEIVD 151 (300)
T ss_pred EEC-CCCCEEEEEcCCCCeEEEEECCCCeEEeEeeCC-CCcce-EEE----CCCCCEEEEEecCCCeEEEEeCCCCeEEE
Confidence 222 23345555542 222222212 121 111100 01111 111 122 233333322122223333333445
Q ss_pred EEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCC-e--EeEEEEEEEcCCCceEE
Q 001655 656 SIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFE-Y--GCSILSCSFSDDSNVYY 732 (1036)
Q Consensus 656 ~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E-~--v~si~~~~l~~~~~~~i 732 (1036)
.++.+..|+.+.+.++.+.+++.+.. ...+.++|..+++.+..+.+.... . ......+.+..++ .++
T Consensus 152 ~~~~~~~~~~~~~s~dg~~l~~~~~~---------~~~v~i~d~~~~~~~~~~~~~~~~~~~~~~~~~~i~~s~dg-~~~ 221 (300)
T TIGR03866 152 NVLVDQRPRFAEFTADGKELWVSSEI---------GGTVSVIDVATRKVIKKITFEIPGVHPEAVQPVGIKLTKDG-KTA 221 (300)
T ss_pred EEEcCCCccEEEECCCCCEEEEEcCC---------CCEEEEEEcCcceeeeeeeecccccccccCCccceEECCCC-CEE
Confidence 56677889999999988876655431 146899999988888776654211 0 0001122343333 344
Q ss_pred EEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cC-eEEEEE--CCEEEEEEee
Q 001655 733 CVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NG-KLLAAI--NQKIQLYKWM 797 (1036)
Q Consensus 733 ~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g-~Lv~~~--g~~l~v~~~~ 797 (1036)
+++.+ ..+++.+|+...+++. ......+.+.+++-- +| +|+++. .++|++|+..
T Consensus 222 ~~~~~---------~~~~i~v~d~~~~~~~--~~~~~~~~~~~~~~~~~g~~l~~~~~~~~~i~v~d~~ 279 (300)
T TIGR03866 222 FVALG---------PANRVAVVDAKTYEVL--DYLLVGQRVWQLAFTPDEKYLLTTNGVSNDVSVIDVA 279 (300)
T ss_pred EEEcC---------CCCeEEEEECCCCcEE--EEEEeCCCcceEEECCCCCEEEEEcCCCCeEEEEECC
Confidence 44432 2357889988655543 222345677777633 34 565554 4688888753
No 41
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=96.28 E-value=0.62 Score=48.74 Aligned_cols=198 Identities=9% Similarity=0.009 Sum_probs=114.9
Q ss_pred CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCC-ceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeee
Q 001655 661 EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQT-FEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYV 739 (1036)
Q Consensus 661 ~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t-~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~ 739 (1036)
.+...++|+|..+-++++.+ |-+.||+.+-+. ...+..-.-.-.--+++++ | .+++ ..+..|.
T Consensus 28 DsIS~l~FSP~~~~~~~A~S---------WD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~-W--sddg-skVf~g~--- 91 (347)
T KOG0647|consen 28 DSISALAFSPQADNLLAAGS---------WDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVC-W--SDDG-SKVFSGG--- 91 (347)
T ss_pred cchheeEeccccCceEEecc---------cCCceEEEEEecCCcccchhhhccCCCeEEEE-E--ccCC-ceEEeec---
Confidence 45567889985555555544 446787776532 3333221112222345543 3 3333 4455554
Q ss_pred CCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeE--EEEEC---CEEEEEEeeecCCCccchhccccccc
Q 001655 740 LPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKL--LAAIN---QKIQLYKWMLRDDGTRELQSECGHHG 814 (1036)
Q Consensus 740 ~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~L--v~~~g---~~l~v~~~~~~~~~~~~L~~~~~~~~ 814 (1036)
+.|.+.+|++..+....+. .+.+||.++.-+++++ +.+.| ++|+.++ .+. -.+......
T Consensus 92 -------~Dk~~k~wDL~S~Q~~~v~--~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD--~R~-----~~pv~t~~L 155 (347)
T KOG0647|consen 92 -------CDKQAKLWDLASGQVSQVA--AHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWD--TRS-----SNPVATLQL 155 (347)
T ss_pred -------cCCceEEEEccCCCeeeee--ecccceeEEEEecCCCcceeEecccccceeecc--cCC-----CCeeeeeec
Confidence 4567888998877665555 5689999999888765 55555 4565533 221 111222333
Q ss_pred ceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEE-EEEeeCceEEEEccCCcEEEEeeCCCCC
Q 001655 815 HILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSA-VEILDDDIYLGAENNFNLFTVRKNSEGA 891 (1036)
Q Consensus 815 ~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~-~~~l~~~~~l~~D~~gnl~~l~~~~~~~ 891 (1036)
+--...+++...+.+|+.+-+++.++.....+..+.... .+-.-.+.+ ++|-+.+.++.+--+|-+.+...++..+
T Consensus 156 PeRvYa~Dv~~pm~vVata~r~i~vynL~n~~te~k~~~-SpLk~Q~R~va~f~d~~~~alGsiEGrv~iq~id~~~~ 232 (347)
T KOG0647|consen 156 PERVYAADVLYPMAVVATAERHIAVYNLENPPTEFKRIE-SPLKWQTRCVACFQDKDGFALGSIEGRVAIQYIDDPNP 232 (347)
T ss_pred cceeeehhccCceeEEEecCCcEEEEEcCCCcchhhhhc-CcccceeeEEEEEecCCceEeeeecceEEEEecCCCCc
Confidence 333455777889999999999999887754333332221 121122223 2355666777777899999888876433
No 42
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=96.27 E-value=1 Score=48.08 Aligned_cols=72 Identities=22% Similarity=0.256 Sum_probs=50.0
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCc-cCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGE-IIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~-~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
.-|-|+++.|. .++++-|.- |+.+.||++...++..+ |+.. ...+.+.+.. .-+|||.+..|+.+-+|
T Consensus 152 gWVr~vavdP~------n~wf~tgs~-DrtikIwDlatg~Lklt--ltGhi~~vr~vavS~--rHpYlFs~gedk~VKCw 220 (460)
T KOG0285|consen 152 GWVRSVAVDPG------NEWFATGSA-DRTIKIWDLATGQLKLT--LTGHIETVRGVAVSK--RHPYLFSAGEDKQVKCW 220 (460)
T ss_pred ceEEEEeeCCC------ceeEEecCC-CceeEEEEcccCeEEEe--ecchhheeeeeeecc--cCceEEEecCCCeeEEE
Confidence 45679998773 457776666 99999999987554332 2211 2345555543 35899999999999999
Q ss_pred EEec
Q 001655 557 LLNM 560 (1036)
Q Consensus 557 ~~~~ 560 (1036)
.+..
T Consensus 221 DLe~ 224 (460)
T KOG0285|consen 221 DLEY 224 (460)
T ss_pred echh
Confidence 8864
No 43
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=96.24 E-value=0.72 Score=48.42 Aligned_cols=249 Identities=11% Similarity=0.127 Sum_probs=136.4
Q ss_pred CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 661 EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 661 ~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
....++.|+|.++.++|.+- -++++++|....+.. .+|+..-.++++ .|.+ ...+++|+
T Consensus 14 d~IS~v~f~~~~~~LLvssW----------DgslrlYdv~~~~l~--~~~~~~~plL~c---~F~d--~~~~~~G~---- 72 (323)
T KOG1036|consen 14 DGISSVKFSPSSSDLLVSSW----------DGSLRLYDVPANSLK--LKFKHGAPLLDC---AFAD--ESTIVTGG---- 72 (323)
T ss_pred hceeeEEEcCcCCcEEEEec----------cCcEEEEeccchhhh--hheecCCceeee---eccC--CceEEEec----
Confidence 45567888988887777764 478999987655322 234444444444 3433 45577776
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeEEE-EECCEEEEEEeeecCCCccchhcccccccceE
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKLLA-AINQKIQLYKWMLRDDGTRELQSECGHHGHIL 817 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~Lv~-~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~ 817 (1036)
..|.|..+++.-+.-..+. ...+++.+|+.. .|.++. +=+++|.+++ .+. +... ..++..--
T Consensus 73 ------~dg~vr~~Dln~~~~~~ig--th~~~i~ci~~~~~~~~vIsgsWD~~ik~wD--~R~---~~~~--~~~d~~kk 137 (323)
T KOG1036|consen 73 ------LDGQVRRYDLNTGNEDQIG--THDEGIRCIEYSYEVGCVISGSWDKTIKFWD--PRN---KVVV--GTFDQGKK 137 (323)
T ss_pred ------cCceEEEEEecCCcceeec--cCCCceEEEEeeccCCeEEEcccCccEEEEe--ccc---cccc--cccccCce
Confidence 4588888888744333333 457889999877 566654 3457888855 321 1111 11122224
Q ss_pred EEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEecc-CCcceeEEEEEeeC-ceEEEEccCCcEEEEeeCCCCCCccc
Q 001655 818 ALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARD-YNANWMSAVEILDD-DIYLGAENNFNLFTVRKNSEGATDEE 895 (1036)
Q Consensus 818 ~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D-~~~~~~~~~~~l~~-~~~l~~D~~gnl~~l~~~~~~~~~~~ 895 (1036)
+-++++.+|+++||...+.+.++....-..-+ --|+ .....+.++.++.+ .-++++--+|-+.+=-.++....+..
T Consensus 138 Vy~~~v~g~~LvVg~~~r~v~iyDLRn~~~~~--q~reS~lkyqtR~v~~~pn~eGy~~sSieGRVavE~~d~s~~~~sk 215 (323)
T KOG1036|consen 138 VYCMDVSGNRLVVGTSDRKVLIYDLRNLDEPF--QRRESSLKYQTRCVALVPNGEGYVVSSIEGRVAVEYFDDSEEAQSK 215 (323)
T ss_pred EEEEeccCCEEEEeecCceEEEEEcccccchh--hhccccceeEEEEEEEecCCCceEEEeecceEEEEccCCchHHhhh
Confidence 56678899999999999998776543311111 1112 12233445555553 34777778998876544443211111
Q ss_pred ccceeE----EEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEecChhHHHHHH
Q 001655 896 RGRLEV----VGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASLPHEQYLFLE 958 (1036)
Q Consensus 896 ~~~L~~----~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l~~~~~~~L~ 958 (1036)
+..+.+ .....+.=.||++.... ....+..|+.||-+-.--+.+.+.++-|.
T Consensus 216 kyaFkCHr~~~~~~~~~yPVNai~Fhp-----------~~~tfaTgGsDG~V~~Wd~~~rKrl~q~~ 271 (323)
T KOG1036|consen 216 KYAFKCHRLSEKDTEIIYPVNAIAFHP-----------IHGTFATGGSDGIVNIWDLFNRKRLKQLA 271 (323)
T ss_pred ceeEEeeecccCCceEEEEeceeEecc-----------ccceEEecCCCceEEEccCcchhhhhhcc
Confidence 111100 01112222344442211 12345566788888777777665544333
No 44
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=96.19 E-value=0.4 Score=54.51 Aligned_cols=76 Identities=17% Similarity=0.200 Sum_probs=52.4
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCC-------ccCceeEEee--eec----CeEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGG-------EIIPRSVLLC--AFE----GISYL 544 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~-------~~~p~si~~~--~~~----~~~~L 544 (1036)
.+|++++.+. --+++||+- +|++.|+++..-.+++...+.. ...+.++.+. ..+ ..+.|
T Consensus 87 g~vtal~~S~-------iGFvaigy~-~G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L 158 (395)
T PF08596_consen 87 GPVTALKNSD-------IGFVAIGYE-SGSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICL 158 (395)
T ss_dssp -SEEEEEE-B-------TSEEEEEET-TSEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEE
T ss_pred CcEeEEecCC-------CcEEEEEec-CCcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEE
Confidence 5667776643 359999986 9999999998878887655532 1234455443 222 35889
Q ss_pred EEEeCCCcEEEEEEecC
Q 001655 545 LCALGDGHLLNFLLNMK 561 (1036)
Q Consensus 545 ~vgl~~G~l~~y~~~~~ 561 (1036)
+||+..|.++.|++.+.
T Consensus 159 ~vGTn~G~v~~fkIlp~ 175 (395)
T PF08596_consen 159 LVGTNSGNVLTFKILPS 175 (395)
T ss_dssp EEEETTSEEEEEEEEE-
T ss_pred EEEeCCCCEEEEEEecC
Confidence 99999999999999863
No 45
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=95.99 E-value=5.2 Score=47.85 Aligned_cols=394 Identities=13% Similarity=0.121 Sum_probs=199.3
Q ss_pred eEEEEecCcEEEEecCCccceeeeeCCCCCcEEEEEeCC--CEEEEEEcCCeEEEEEEcCcEEEEEEeccC-CceeEEEE
Q 001655 408 QLVQVTSGSVRLVSSTSRELRNEWKSPPGYSVNVATANA--SQVLLATGGGHLVYLEIGDGILTEVKHAQL-EYEISCLD 484 (1036)
Q Consensus 408 ~~vQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~--~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l-~~~is~l~ 484 (1036)
.++=.+...+.+++..+++.+.+... .+..|+++.-.+ ++++|...+|+++.|.+..++... ++.. ...|+.++
T Consensus 175 IvvGs~~G~lql~Nvrt~K~v~~f~~-~~s~IT~ieqsPaLDVVaiG~~~G~ViifNlK~dkil~--sFk~d~g~VtslS 251 (910)
T KOG1539|consen 175 IVVGSSQGRLQLWNVRTGKVVYTFQE-FFSRITAIEQSPALDVVAIGLENGTVIIFNLKFDKILM--SFKQDWGRVTSLS 251 (910)
T ss_pred EEEeecCCcEEEEEeccCcEEEEecc-cccceeEeccCCcceEEEEeccCceEEEEEcccCcEEE--EEEccccceeEEE
Confidence 34445556666677666555554321 225788887654 578888889999999886543322 2333 48899999
Q ss_pred cCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEec-CCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCC
Q 001655 485 INPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEH-LGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTG 563 (1036)
Q Consensus 485 ~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~-l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~ 563 (1036)
+.. .....++.|.- .|.+.+|+|++-+++.... .....++ ... -+.+++.|+-...|..+..|-+|..+|
T Consensus 252 Frt-----DG~p~las~~~-~G~m~~wDLe~kkl~~v~~nah~~sv~-~~~--fl~~epVl~ta~~DnSlk~~vfD~~dg 322 (910)
T KOG1539|consen 252 FRT-----DGNPLLASGRS-NGDMAFWDLEKKKLINVTRNAHYGSVT-GAT--FLPGEPVLVTAGADNSLKVWVFDSGDG 322 (910)
T ss_pred ecc-----CCCeeEEeccC-CceEEEEEcCCCeeeeeeeccccCCcc-cce--ecCCCceEeeccCCCceeEEEeeCCCC
Confidence 843 13567777766 8999999998755543211 1111121 111 123567777778899999999996655
Q ss_pred ccccceeeecC-ccceEEEEEEeCCceEEEEE--c-CCceEEEec-----CCcEEE-------eeec--------cccce
Q 001655 564 ELTDRKKVSLG-TQPITLRTFSSKNTTHVFAA--S-DRPTVIYSS-----NKKLLY-------SNVN--------LKEVS 619 (1036)
Q Consensus 564 ~l~~~~~~~lG-~~pv~l~~~~~~~~~~v~~~--~-~~p~~i~~~-----~~~~~~-------~~~~--------~~~i~ 619 (1036)
..+..|.+ -| ..|....+|. +.++.|+. + |+.+..++- +..+.. -+++ .+++.
T Consensus 323 ~pR~LR~R-~GHs~Pp~~irfy--~~~g~~ilsa~~Drt~r~fs~~~e~~~~~l~~~~~~~~~kk~~~~~~~~~k~p~i~ 399 (910)
T KOG1539|consen 323 VPRLLRSR-GGHSAPPSCIRFY--GSQGHFILSAKQDRTLRSFSVISESQSQELGQLHNKKRAKKVNVFSTEKLKLPPIV 399 (910)
T ss_pred cchheeec-cCCCCCchheeee--ccCcEEEEecccCcchhhhhhhHHHHhHhhcccccccccccccccchhhhcCCcce
Confidence 43322222 23 3443333432 23344443 3 343443321 111100 0111 11222
Q ss_pred eeecccC-CCCCCeEEEEeCCeEEEEEEcCCCCeE------EEEE-eCCCccceEEEecCCCEEEEEEeecCCCCCceee
Q 001655 620 HMCPFNS-AAFPDSLAIAKEGELTIGTIDDIQKLH------IRSI-PLGEHPRRICHQEQSRTFAICSLKNQSCAEESEM 691 (1036)
Q Consensus 620 ~~~~f~~-~~~~~~l~~~~~~~l~i~~l~~~~~~~------~~~i-~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~ 691 (1036)
.++.=+. +..=+.++.+..+.......+..++.. .++. +.+.+.+.++-++=.|..+++++ .
T Consensus 400 ~fa~~~~RE~~W~Nv~~~h~~~~~~~tW~~~n~~~G~~~L~~~~~~~~~~~~~av~vs~CGNF~~IG~S----------~ 469 (910)
T KOG1539|consen 400 EFAFENAREKEWDNVITAHKGKRSAYTWNFRNKTSGRHVLDPKRFKKDDINATAVCVSFCGNFVFIGYS----------K 469 (910)
T ss_pred eeecccchhhhhcceeEEecCcceEEEEeccCcccccEEecCccccccCcceEEEEEeccCceEEEecc----------C
Confidence 2211000 011123444444444433333222110 0000 11223334444433333333332 2
Q ss_pred EEEEEEeCCCceEEEEEE--CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEe
Q 001655 692 HFVRLLDDQTFEFISTYP--LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKET 769 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~--~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~ 769 (1036)
+.|..++-+++-...+|- -...+.+..+.. ++.+-++|.++ ..|-+.+|+.+++. ++++...
T Consensus 470 G~Id~fNmQSGi~r~sf~~~~ah~~~V~gla~-----D~~n~~~vsa~---------~~Gilkfw~f~~k~--l~~~l~l 533 (910)
T KOG1539|consen 470 GTIDRFNMQSGIHRKSFGDSPAHKGEVTGLAV-----DGTNRLLVSAG---------ADGILKFWDFKKKV--LKKSLRL 533 (910)
T ss_pred CeEEEEEcccCeeecccccCccccCceeEEEe-----cCCCceEEEcc---------CcceEEEEecCCcc--eeeeecc
Confidence 567777777765555551 233444554432 34444555553 57999999886543 5666677
Q ss_pred cCceeEecccc--CeEEEEEC-CEEEEEEeeecCCCccchhccc-ccccceEEEEEEEeCCEEEEEeccccEEEEEEecc
Q 001655 770 KGAVYSLNAFN--GKLLAAIN-QKIQLYKWMLRDDGTRELQSEC-GHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHE 845 (1036)
Q Consensus 770 ~g~v~~i~~~~--g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~-~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~ 845 (1036)
..++.++.... +.++++.+ -.|.+++. ..++..+.- .+.......+.+..|..|+.+++-.++-+ ||--
T Consensus 534 ~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~-----~t~kvvR~f~gh~nritd~~FS~DgrWlisasmD~tIr~--wDlp 606 (910)
T KOG1539|consen 534 GSSITGIVYHRVSDLLAIALDDFSIRVVDV-----VTRKVVREFWGHGNRITDMTFSPDGRWLISASMDSTIRT--WDLP 606 (910)
T ss_pred CCCcceeeeeehhhhhhhhcCceeEEEEEc-----hhhhhhHHhhccccceeeeEeCCCCcEEEEeecCCcEEE--Eecc
Confidence 77777766553 34444444 35566663 344555431 12223344555566778888877777654 4543
Q ss_pred CCeE
Q 001655 846 EGAI 849 (1036)
Q Consensus 846 ~~~l 849 (1036)
...+
T Consensus 607 t~~l 610 (910)
T KOG1539|consen 607 TGTL 610 (910)
T ss_pred Ccce
Confidence 3333
No 46
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=95.64 E-value=3.2 Score=42.80 Aligned_cols=221 Identities=13% Similarity=0.158 Sum_probs=112.8
Q ss_pred CcEEEEecCCccceeeeeCCCCCcE-EEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCC
Q 001655 415 GSVRLVSSTSRELRNEWKSPPGYSV-NVATANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPS 493 (1036)
Q Consensus 415 ~~i~l~~~~~~~~~~~w~~~~~~~I-~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~ 493 (1036)
+.||+.+...++..++.... +..| ...+-++.++++...+..+.++...+ .......++..++..++..
T Consensus 87 k~ir~wd~r~~k~~~~i~~~-~eni~i~wsp~g~~~~~~~kdD~it~id~r~--~~~~~~~~~~~e~ne~~w~------- 156 (313)
T KOG1407|consen 87 KTIRIWDIRSGKCTARIETK-GENINITWSPDGEYIAVGNKDDRITFIDART--YKIVNEEQFKFEVNEISWN------- 156 (313)
T ss_pred ceEEEEEeccCcEEEEeecc-CcceEEEEcCCCCEEEEecCcccEEEEEecc--cceeehhcccceeeeeeec-------
Confidence 45555554443444433321 2222 22223455666665666777765533 3333444555666555543
Q ss_pred cccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeec
Q 001655 494 YSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSL 573 (1036)
Q Consensus 494 ~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~l 573 (1036)
.++.+++.+...|.++|++.|.|+++..-.- .+...+++.--...-|+-+|..|-.+--+.+++ |-..|...=
T Consensus 157 ~~nd~Fflt~GlG~v~ILsypsLkpv~si~A---H~snCicI~f~p~GryfA~GsADAlvSLWD~~E----LiC~R~isR 229 (313)
T KOG1407|consen 157 NSNDLFFLTNGLGCVEILSYPSLKPVQSIKA---HPSNCICIEFDPDGRYFATGSADALVSLWDVDE----LICERCISR 229 (313)
T ss_pred CCCCEEEEecCCceEEEEecccccccccccc---CCcceEEEEECCCCceEeeccccceeeccChhH----hhhheeecc
Confidence 1445666667579999999999988643111 112233322112456788888876555444432 222222211
Q ss_pred CccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCCCCeEEEEe-CCeEEEEEEcCCCCe
Q 001655 574 GTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDDIQKL 652 (1036)
Q Consensus 574 G~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~~~~~ 652 (1036)
=..||+-..|.. +|++. +.++ +--+-|+.+++..+
T Consensus 230 ldwpVRTlSFS~-------------------dg~~l------------------------ASaSEDh~IDIA~vetGd~- 265 (313)
T KOG1407|consen 230 LDWPVRTLSFSH-------------------DGRML------------------------ASASEDHFIDIAEVETGDR- 265 (313)
T ss_pred ccCceEEEEecc-------------------Cccee------------------------eccCccceEEeEecccCCe-
Confidence 123444333321 22221 1111 11233444444333
Q ss_pred EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEe
Q 001655 653 HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLD 698 (1036)
Q Consensus 653 ~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d 698 (1036)
+..||-...--.+++||...+++.+|.+... +...+.+.++++-
T Consensus 266 -~~eI~~~~~t~tVAWHPk~~LLAyA~ddk~~-d~~reag~vKiFG 309 (313)
T KOG1407|consen 266 -VWEIPCEGPTFTVAWHPKRPLLAYACDDKDG-DSNREAGTVKIFG 309 (313)
T ss_pred -EEEeeccCCceeEEecCCCceeeEEecCCCC-ccccccceeEEec
Confidence 3566776666789999999999999986521 1223456677663
No 47
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=95.63 E-value=1.1 Score=48.26 Aligned_cols=154 Identities=17% Similarity=0.231 Sum_probs=100.4
Q ss_pred ceeeeecCCCeEEEEecCcEEEEecCCccceeeee--CCCCCcEEEEEeCCCEEEEEE----cCCeEEEEEEcCcEEEEE
Q 001655 398 TLFCHDAIYNQLVQVTSGSVRLVSSTSRELRNEWK--SPPGYSVNVATANASQVLLAT----GGGHLVYLEIGDGILTEV 471 (1036)
Q Consensus 398 Tl~~~~~~~~~~vQVt~~~i~l~~~~~~~~~~~w~--~~~~~~I~~as~~~~~vvv~~----~~~~~~~l~~~~~~l~~~ 471 (1036)
.|.+-.|..+++|=+-+..|.+++.+.-+.+..+. ||......+-+.+.....++. ..|.++++...+ +..+
T Consensus 89 ~IL~VrmNr~RLvV~Lee~IyIydI~~MklLhTI~t~~~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~n--l~~v 166 (391)
T KOG2110|consen 89 SILAVRMNRKRLVVCLEESIYIYDIKDMKLLHTIETTPPNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTIN--LQPV 166 (391)
T ss_pred ceEEEEEccceEEEEEcccEEEEecccceeehhhhccCCCccceEeeccCCCCceEEecCCCCCceEEEEEccc--ceee
Confidence 46677787788888889999999987644444332 345455666666654334443 347787777654 2222
Q ss_pred Eec-cCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeec-CeEEEEEEeC
Q 001655 472 KHA-QLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFE-GISYLLCALG 549 (1036)
Q Consensus 472 ~~~-~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~-~~~~L~vgl~ 549 (1036)
... .-+..+.|+++++ .+..++-+..+.--|++|++|+.+.+.+..-+ ..|.+|.-..|. +..+|-+...
T Consensus 167 ~~I~aH~~~lAalafs~------~G~llATASeKGTVIRVf~v~~G~kl~eFRRG--~~~~~IySL~Fs~ds~~L~~sS~ 238 (391)
T KOG2110|consen 167 NTINAHKGPLAALAFSP------DGTLLATASEKGTVIRVFSVPEGQKLYEFRRG--TYPVSIYSLSFSPDSQFLAASSN 238 (391)
T ss_pred eEEEecCCceeEEEECC------CCCEEEEeccCceEEEEEEcCCccEeeeeeCC--ceeeEEEEEEECCCCCeEEEecC
Confidence 211 3357789999975 35677776664446899999998877654443 235444322332 5678888999
Q ss_pred CCcEEEEEEecC
Q 001655 550 DGHLLNFLLNMK 561 (1036)
Q Consensus 550 ~G~l~~y~~~~~ 561 (1036)
.+.+-.|+++..
T Consensus 239 TeTVHiFKL~~~ 250 (391)
T KOG2110|consen 239 TETVHIFKLEKV 250 (391)
T ss_pred CCeEEEEEeccc
Confidence 999999998754
No 48
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=95.37 E-value=0.92 Score=53.46 Aligned_cols=141 Identities=21% Similarity=0.258 Sum_probs=86.8
Q ss_pred CCeEEEEeCCeEEEEEEcCCCCeEEEEEeCCC--ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE
Q 001655 630 PDSLAIAKEGELTIGTIDDIQKLHIRSIPLGE--HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST 707 (1036)
Q Consensus 630 ~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~--tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~ 707 (1036)
|.++++++.+.=+.+++........-+|-.|. -...+.|||..+..+-++++ .++|+.|..++..+--
T Consensus 503 P~GyYFatas~D~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD----------~tVRlWDv~~G~~VRi 572 (707)
T KOG0263|consen 503 PRGYYFATASHDQTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSD----------RTVRLWDVSTGNSVRI 572 (707)
T ss_pred CCceEEEecCCCceeeeeecccCCchhhhcccccccceEEECCcccccccCCCC----------ceEEEEEcCCCcEEEE
Confidence 44667766544445566554444444555553 56778999998877766554 3788888877766544
Q ss_pred EECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEE
Q 001655 708 YPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAA 786 (1036)
Q Consensus 708 ~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~ 786 (1036)
| .++. -.+..+.+.- ...|++-|. .-|+|.+|++.++++-.... .+.|.|+++.-- +|.++++
T Consensus 573 F---~GH~-~~V~al~~Sp-~Gr~LaSg~----------ed~~I~iWDl~~~~~v~~l~-~Ht~ti~SlsFS~dg~vLas 636 (707)
T KOG0263|consen 573 F---TGHK-GPVTALAFSP-CGRYLASGD----------EDGLIKIWDLANGSLVKQLK-GHTGTIYSLSFSRDGNVLAS 636 (707)
T ss_pred e---cCCC-CceEEEEEcC-CCceEeecc----------cCCcEEEEEcCCCcchhhhh-cccCceeEEEEecCCCEEEe
Confidence 4 2332 1222333332 356777664 45899999999876543322 228999998843 5655544
Q ss_pred --ECCEEEEEEe
Q 001655 787 --INQKIQLYKW 796 (1036)
Q Consensus 787 --~g~~l~v~~~ 796 (1036)
.+++|.+|++
T Consensus 637 gg~DnsV~lWD~ 648 (707)
T KOG0263|consen 637 GGADNSVRLWDL 648 (707)
T ss_pred cCCCCeEEEEEc
Confidence 4478888765
No 49
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=95.35 E-value=5.3 Score=43.41 Aligned_cols=237 Identities=11% Similarity=0.218 Sum_probs=112.4
Q ss_pred CCEEEEEE-cCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecC
Q 001655 446 ASQVLLAT-GGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHL 524 (1036)
Q Consensus 446 ~~~vvv~~-~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l 524 (1036)
+..++++. .++.+..++...+++.. .......+.++++.+ ....++++...++.+.+|++.+.+.+.....
T Consensus 42 g~~l~~~~~~~~~v~~~d~~~~~~~~--~~~~~~~~~~~~~~~------~g~~l~~~~~~~~~l~~~d~~~~~~~~~~~~ 113 (300)
T TIGR03866 42 GKLLYVCASDSDTIQVIDLATGEVIG--TLPSGPDPELFALHP------NGKILYIANEDDNLVTVIDIETRKVLAEIPV 113 (300)
T ss_pred CCEEEEEECCCCeEEEEECCCCcEEE--eccCCCCccEEEECC------CCCEEEEEcCCCCeEEEEECCCCeEEeEeeC
Confidence 33444433 34566666655444322 122233445566643 2456666666588999999987655443222
Q ss_pred CCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCC-ceE-EE
Q 001655 525 GGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDR-PTV-IY 602 (1036)
Q Consensus 525 ~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~-p~~-i~ 602 (1036)
. ..|.++.+.+ +...++++..++..+.+ ++..++.+. .....+..|..+ .+. .+...+++.++. ..+ ++
T Consensus 114 ~--~~~~~~~~~~--dg~~l~~~~~~~~~~~~-~d~~~~~~~--~~~~~~~~~~~~-~~s-~dg~~l~~~~~~~~~v~i~ 184 (300)
T TIGR03866 114 G--VEPEGMAVSP--DGKIVVNTSETTNMAHF-IDTKTYEIV--DNVLVDQRPRFA-EFT-ADGKELWVSSEIGGTVSVI 184 (300)
T ss_pred C--CCcceEEECC--CCCEEEEEecCCCeEEE-EeCCCCeEE--EEEEcCCCccEE-EEC-CCCCEEEEEcCCCCEEEEE
Confidence 2 3455665443 34566677766654322 333322211 112233344322 221 223345454432 222 22
Q ss_pred ec-CCcEEEeeec--cccc--eeeecccCCCCCC--eEEEE--eCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCC
Q 001655 603 SS-NKKLLYSNVN--LKEV--SHMCPFNSAAFPD--SLAIA--KEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSR 673 (1036)
Q Consensus 603 ~~-~~~~~~~~~~--~~~i--~~~~~f~~~~~~~--~l~~~--~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~ 673 (1036)
.. .++.. ..+. .... ..+.+......++ .++.. .++.+.+-.+.+. + ..+.+..+..|..+.++|+.+
T Consensus 185 d~~~~~~~-~~~~~~~~~~~~~~~~~~~i~~s~dg~~~~~~~~~~~~i~v~d~~~~-~-~~~~~~~~~~~~~~~~~~~g~ 261 (300)
T TIGR03866 185 DVATRKVI-KKITFEIPGVHPEAVQPVGIKLTKDGKTAFVALGPANRVAVVDAKTY-E-VLDYLLVGQRVWQLAFTPDEK 261 (300)
T ss_pred EcCcceee-eeeeecccccccccCCccceEECCCCCEEEEEcCCCCeEEEEECCCC-c-EEEEEEeCCCcceEEECCCCC
Confidence 11 22211 1110 0000 0111111001122 22222 2455665554322 1 234456677889999999888
Q ss_pred EEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 674 TFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 674 ~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
.+++.... ...|.++|..+++.+.++++.
T Consensus 262 ~l~~~~~~---------~~~i~v~d~~~~~~~~~~~~~ 290 (300)
T TIGR03866 262 YLLTTNGV---------SNDVSVIDVAALKVIKSIKVG 290 (300)
T ss_pred EEEEEcCC---------CCeEEEEECCCCcEEEEEEcc
Confidence 66554321 247999999999988887763
No 50
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=95.29 E-value=4.9 Score=42.70 Aligned_cols=257 Identities=14% Similarity=0.187 Sum_probs=143.6
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCC
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPE 742 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~ 742 (1036)
+..+.+..+..+|+|++.. ..++++-+.++...+-++... ...+..+-+.. +-+-+||.+..
T Consensus 8 ~lsvs~NQD~ScFava~~~-----------Gfriyn~~P~ke~~~r~~~~~--G~~~veMLfR~--N~laLVGGg~~--- 69 (346)
T KOG2111|consen 8 TLSVSFNQDHSCFAVATDT-----------GFRIYNCDPFKESASRQFIDG--GFKIVEMLFRS--NYLALVGGGSR--- 69 (346)
T ss_pred eeEEEEccCCceEEEEecC-----------ceEEEecCchhhhhhhccccC--chhhhhHhhhh--ceEEEecCCCC---
Confidence 3347788888899998753 345554333433332222221 12333332321 23445674331
Q ss_pred CCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEeeec----------C--C---------
Q 001655 743 ENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWMLR----------D--D--------- 801 (1036)
Q Consensus 743 e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~~~----------~--~--------- 801 (1036)
..-..-.+++|+ +.|-+.+.+.++.++|.+|+--.++|++..-++|++|.+... . .
T Consensus 70 -pky~pNkviIWD--D~k~~~i~el~f~~~I~~V~l~r~riVvvl~~~I~VytF~~n~k~l~~~et~~NPkGlC~~~~~~ 146 (346)
T KOG2111|consen 70 -PKYPPNKVIIWD--DLKERCIIELSFNSEIKAVKLRRDRIVVVLENKIYVYTFPDNPKLLHVIETRSNPKGLCSLCPTS 146 (346)
T ss_pred -CCCCCceEEEEe--cccCcEEEEEEeccceeeEEEcCCeEEEEecCeEEEEEcCCChhheeeeecccCCCceEeecCCC
Confidence 122445788887 556667888899999999998899999999999999997410 0 0
Q ss_pred ------------Cccchhcccc-----------cccceEEEEEEEeCCEEEEEeccccEEEEEEeccC-CeEEEEeccCC
Q 001655 802 ------------GTRELQSECG-----------HHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEE-GAIEERARDYN 857 (1036)
Q Consensus 802 ------------~~~~L~~~~~-----------~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~-~~l~~~a~D~~ 857 (1036)
|+.++.-.+. ++..+..+.|.-.|. +++.-..+|.-+=-|+.++ ..+.++-|-..
T Consensus 147 ~k~~LafPg~k~GqvQi~dL~~~~~~~p~~I~AH~s~Iacv~Ln~~Gt-~vATaStkGTLIRIFdt~~g~~l~E~RRG~d 225 (346)
T KOG2111|consen 147 NKSLLAFPGFKTGQVQIVDLASTKPNAPSIINAHDSDIACVALNLQGT-LVATASTKGTLIRIFDTEDGTLLQELRRGVD 225 (346)
T ss_pred CceEEEcCCCccceEEEEEhhhcCcCCceEEEcccCceeEEEEcCCcc-EEEEeccCcEEEEEEEcCCCcEeeeeecCCc
Confidence 1111111000 011111223333444 4455556666555577654 56778888888
Q ss_pred cceeEEEEEeeCceE-EEEccCCcEEEEeeCCCCCCcccccce--------------eEEEEEEcCCccceEEeeeeeec
Q 001655 858 ANWMSAVEILDDDIY-LGAENNFNLFTVRKNSEGATDEERGRL--------------EVVGEYHLGEFVNRFRHGSLVMR 922 (1036)
Q Consensus 858 ~~~~~~~~~l~~~~~-l~~D~~gnl~~l~~~~~~~~~~~~~~L--------------~~~~~~~lg~~v~~~~~~~l~~~ 922 (1036)
+-.+.++.|=.+..+ .++-..|.+++|..-....+..+...+ -..+.|++.+..-.+. .
T Consensus 226 ~A~iy~iaFSp~~s~LavsSdKgTlHiF~l~~~~~~~~~~SSl~~~~~~lpky~~S~wS~~~f~l~~~~~~~~------~ 299 (346)
T KOG2111|consen 226 RADIYCIAFSPNSSWLAVSSDKGTLHIFSLRDTENTEDESSSLSFKRLVLPKYFSSEWSFAKFQLPQGTQCII------A 299 (346)
T ss_pred hheEEEEEeCCCccEEEEEcCCCeEEEEEeecCCCCccccccccccccccchhcccceeEEEEEccCCCcEEE------E
Confidence 878888877666554 456678999999876533221100011 1234455543321111 1
Q ss_pred CCCCCCCCcceEEEEccccceEEEEecCh
Q 001655 923 LPDSDVGQIPTVIFGTVNGVIGVIASLPH 951 (1036)
Q Consensus 923 ~~~~~~~~~~~il~~t~~GsIg~l~~l~~ 951 (1036)
| ......++..+.||+-+.+.--.+
T Consensus 300 f----g~~~nsvi~i~~Dgsy~k~~f~~~ 324 (346)
T KOG2111|consen 300 F----GSETNTVIAICADGSYYKFKFDPK 324 (346)
T ss_pred e----cCCCCeEEEEEeCCcEEEEEeccc
Confidence 1 112267788889999988776654
No 51
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=95.26 E-value=8.2 Score=45.10 Aligned_cols=493 Identities=14% Similarity=0.088 Sum_probs=225.2
Q ss_pred cceeeEEEEEecCCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEecCCeEEEEEeecCeeEEEEeeC
Q 001655 200 PSITKAYGRVDADGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQ 279 (1036)
Q Consensus 200 ~~~~~~~~~~~~~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~ 279 (1036)
+..++|-+... +.+++.++..+|.+-.=.+..+ --.. .+.+.++...-.+|+...++-||-. ..++.+..++.-
T Consensus 25 Ps~I~slA~s~-kS~~lAvsRt~g~IEiwN~~~~--w~~~-~vi~g~~drsIE~L~W~e~~RLFS~--g~sg~i~EwDl~ 98 (691)
T KOG2048|consen 25 PSEIVSLAYSH-KSNQLAVSRTDGNIEIWNLSNN--WFLE-PVIHGPEDRSIESLAWAEGGRLFSS--GLSGSITEWDLH 98 (691)
T ss_pred ccceEEEEEec-cCCceeeeccCCcEEEEccCCC--ceee-EEEecCCCCceeeEEEccCCeEEee--cCCceEEEEecc
Confidence 34455655444 3457888999998755544322 1111 1222344455567777788889955 455667777643
Q ss_pred CCCCCCcEEEeeec-ccCCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecCCceeEEEe-eeCCCc-ceEEEeecC
Q 001655 280 PDAKGSYVEVLERY-VNLGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNGIGINEQAS-VELQGI-KGMWSLRSS 356 (1036)
Q Consensus 280 ~~~~~~~~~~~~~l-~n~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~-~~l~~~-~~iw~l~~~ 356 (1036)
. ++.+-.+ +|-|+|..|++-+.. +.+.+.| .+|.|..+. +++.++.. .-|+-. .++.++...
T Consensus 99 ~------lk~~~~~d~~gg~IWsiai~p~~----~~l~Igc---ddGvl~~~s--~~p~~I~~~r~l~rq~sRvLslsw~ 163 (691)
T KOG2048|consen 99 T------LKQKYNIDSNGGAIWSIAINPEN----TILAIGC---DDGVLYDFS--IGPDKITYKRSLMRQKSRVLSLSWN 163 (691)
T ss_pred c------CceeEEecCCCcceeEEEeCCcc----ceEEeec---CCceEEEEe--cCCceEEEEeecccccceEEEEEec
Confidence 2 2222223 577899999987642 3343332 344443333 33433332 112211 133333221
Q ss_pred CCCCcccEEEEEecCc-eEEEEecCCCCeeeeeecCeeccccceeeeecCCCeEEEEecCcEEEEecCCccceeeeeCCC
Q 001655 357 TDDPFDTFLVVSFISE-TRILAMNLEDELEETEIEGFCSQTQTLFCHDAIYNQLVQVTSGSVRLVSSTSRELRNEWKSPP 435 (1036)
Q Consensus 357 ~~~~~~~~lv~S~~~~-T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~ 435 (1036)
. .+..|+....+. -+++.... ..|++. +|-+--++ ..+....-|.
T Consensus 164 ~---~~~~i~~Gs~Dg~Iriwd~~~---------------~~t~~~----------~~~~~d~l---~k~~~~iVWS--- 209 (691)
T KOG2048|consen 164 P---TGTKIAGGSIDGVIRIWDVKS---------------GQTLHI----------ITMQLDRL---SKREPTIVWS--- 209 (691)
T ss_pred C---CccEEEecccCceEEEEEcCC---------------CceEEE----------eeeccccc---ccCCceEEEE---
Confidence 0 011111111111 11111100 011110 01000000 0011122231
Q ss_pred CCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 436 GYSVNVATANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 436 ~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
.....++.++-..+.|.+.+-+-..+++.+.. .-....|-||+..+ .++.++.+.- |+.+.-|++..
T Consensus 210 -----v~~Lrd~tI~sgDS~G~V~FWd~~~gTLiqS~-~~h~adVl~Lav~~------~~d~vfsaGv-d~~ii~~~~~~ 276 (691)
T KOG2048|consen 210 -----VLFLRDSTIASGDSAGTVTFWDSIFGTLIQSH-SCHDADVLALAVAD------NEDRVFSAGV-DPKIIQYSLTT 276 (691)
T ss_pred -----EEEeecCcEEEecCCceEEEEcccCcchhhhh-hhhhcceeEEEEcC------CCCeEEEccC-CCceEEEEecC
Confidence 12234556665666677766554445544432 23467788888753 3567777766 78777777654
Q ss_pred CCeeEEecCCCc---cCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCC--cc----ccceeeecCccceEEEEEEeC
Q 001655 516 LNLITKEHLGGE---IIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTG--EL----TDRKKVSLGTQPITLRTFSSK 586 (1036)
Q Consensus 516 l~~v~~~~l~~~---~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~--~l----~~~~~~~lG~~pv~l~~~~~~ 586 (1036)
-.--+......+ .-.+++++.. ..|+-|-+|+.|+......... .. ...+.+..+...-+|.-+.
T Consensus 277 ~~~~wv~~~~r~~h~hdvrs~av~~----~~l~sgG~d~~l~i~~s~~~~~~~h~~~~~~p~~~~v~~a~~~~L~~~w-- 350 (691)
T KOG2048|consen 277 NKSEWVINSRRDLHAHDVRSMAVIE----NALISGGRDFTLAICSSREFKNMDHRQKNLFPASDRVSVAPENRLLVLW-- 350 (691)
T ss_pred CccceeeeccccCCcccceeeeeec----ceEEecceeeEEEEccccccCchhhhccccccccceeecCccceEEEEe--
Confidence 221121111112 2334554442 3677888888887765443110 00 0000010110000111110
Q ss_pred CceEEEEEcCCceEEEec--CC-----cE-EEeeeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEE-
Q 001655 587 NTTHVFAASDRPTVIYSS--NK-----KL-LYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSI- 657 (1036)
Q Consensus 587 ~~~~v~~~~~~p~~i~~~--~~-----~~-~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i- 657 (1036)
+..+-.+|.+-+. .| ++ .+.--....|.+.+ ...+++-+++.+-..++|.+|........+++
T Consensus 351 -----~~h~v~lwrlGS~~~~g~~~~~~Llkl~~k~~~nIs~~a---iSPdg~~Ia~st~~~~~iy~L~~~~~vk~~~v~ 422 (691)
T KOG2048|consen 351 -----KAHGVDLWRLGSVILQGEYNYIHLLKLFTKEKENISCAA---ISPDGNLIAISTVSRTKIYRLQPDPNVKVINVD 422 (691)
T ss_pred -----ccccccceeccCcccccccChhhheeeecCCccceeeec---cCCCCCEEEEeeccceEEEEeccCcceeEEEec
Confidence 0112233333221 11 11 11100011222211 12234457777889999999988663333322
Q ss_pred --eCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCC--CceEEEEEECCCCCeEeEEEEEEEcCCCceEE
Q 001655 658 --PLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQ--TFEFISTYPLDTFEYGCSILSCSFSDDSNVYY 732 (1036)
Q Consensus 658 --~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~--t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i 732 (1036)
|+. .+..++.+..+.+..+++... ...+..++.. +++.+..+ .+--.+-+|+.+... ...+||
T Consensus 423 ~~~~~~~~a~~i~ftid~~k~~~~s~~---------~~~le~~el~~ps~kel~~~--~~~~~~~~I~~l~~S-sdG~yi 490 (691)
T KOG2048|consen 423 DVPLALLDASAISFTIDKNKLFLVSKN---------IFSLEEFELETPSFKELKSI--QSQAKCPSISRLVVS-SDGNYI 490 (691)
T ss_pred cchhhhccceeeEEEecCceEEEEecc---------cceeEEEEecCcchhhhhcc--ccccCCCcceeEEEc-CCCCEE
Confidence 332 245667777666666655521 2344444332 23322221 111111223333222 236788
Q ss_pred EEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc---cCeEEE-EECCEEEEEEee
Q 001655 733 CVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF---NGKLLA-AINQKIQLYKWM 797 (1036)
Q Consensus 733 ~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~---~g~Lv~-~~g~~l~v~~~~ 797 (1036)
||-+ +.|-|++|.+...+.+.+.. ..+-+|++..-- .+.|++ -.+++++-|+++
T Consensus 491 aa~~----------t~g~I~v~nl~~~~~~~l~~-rln~~vTa~~~~~~~~~~lvvats~nQv~efdi~ 548 (691)
T KOG2048|consen 491 AAIS----------TRGQIFVYNLETLESHLLKV-RLNIDVTAAAFSPFVRNRLVVATSNNQVFEFDIE 548 (691)
T ss_pred EEEe----------ccceEEEEEcccceeecchh-ccCcceeeeeccccccCcEEEEecCCeEEEEecc
Confidence 8876 56899999888666554431 233566665532 467765 567899888874
No 52
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=95.24 E-value=0.41 Score=53.07 Aligned_cols=251 Identities=14% Similarity=0.215 Sum_probs=132.6
Q ss_pred CCeEEEEEEcCCCCeEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeE
Q 001655 638 EGELTIGTIDDIQKLHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYG 716 (1036)
Q Consensus 638 ~~~l~i~~l~~~~~~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v 716 (1036)
++.+.|-.+-...+. .|...-- ...+-+.+.+....|.-++.+ ..+++.|-+|++++.++. .++.+
T Consensus 236 D~~vklW~vy~~~~~-lrtf~gH~k~Vrd~~~s~~g~~fLS~sfD----------~~lKlwDtETG~~~~~f~--~~~~~ 302 (503)
T KOG0282|consen 236 DGLVKLWNVYDDRRC-LRTFKGHRKPVRDASFNNCGTSFLSASFD----------RFLKLWDTETGQVLSRFH--LDKVP 302 (503)
T ss_pred CceEEEEEEecCcce-ehhhhcchhhhhhhhccccCCeeeeeecc----------eeeeeeccccceEEEEEe--cCCCc
Confidence 566666666553321 2222221 233445666655555555444 489999999999887655 55677
Q ss_pred eEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEE-EecCceeEecccc-C-eEEEEE-CCEEE
Q 001655 717 CSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEK-ETKGAVYSLNAFN-G-KLLAAI-NQKIQ 792 (1036)
Q Consensus 717 ~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~-~~~g~v~~i~~~~-g-~Lv~~~-g~~l~ 792 (1036)
.|+ +|.-++.+.+++|+ ..|+|.-|++..+++ +.+. ..-|+|..|.-+. | +.+.+. .+.++
T Consensus 303 ~cv---kf~pd~~n~fl~G~----------sd~ki~~wDiRs~kv--vqeYd~hLg~i~~i~F~~~g~rFissSDdks~r 367 (503)
T KOG0282|consen 303 TCV---KFHPDNQNIFLVGG----------SDKKIRQWDIRSGKV--VQEYDRHLGAILDITFVDEGRRFISSSDDKSVR 367 (503)
T ss_pred eee---ecCCCCCcEEEEec----------CCCcEEEEeccchHH--HHHHHhhhhheeeeEEccCCceEeeeccCccEE
Confidence 665 45555678889998 458999999987663 3322 3457888888773 3 444444 46788
Q ss_pred EEEeeecCCCccchhcccccccceEEEEE---------EEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEE
Q 001655 793 LYKWMLRDDGTRELQSECGHHGHILALYV---------QTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSA 863 (1036)
Q Consensus 793 v~~~~~~~~~~~~L~~~~~~~~~~~~~~l---------~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~ 863 (1036)
+|+|... -..++...-...+. ..+.+ .+.+|+|++--+ ...|+....+ ....-..+-..+.
T Consensus 368 iWe~~~~--v~ik~i~~~~~hsm-P~~~~~P~~~~~~aQs~dN~i~ifs~-----~~~~r~nkkK--~feGh~vaGys~~ 437 (503)
T KOG0282|consen 368 IWENRIP--VPIKNIADPEMHTM-PCLTLHPNGKWFAAQSMDNYIAIFST-----VPPFRLNKKK--RFEGHSVAGYSCQ 437 (503)
T ss_pred EEEcCCC--ccchhhcchhhccC-cceecCCCCCeehhhccCceEEEEec-----ccccccCHhh--hhcceeccCceee
Confidence 8887421 12222211111111 12222 334555544111 1112211111 0111111222234
Q ss_pred EEEeeC-ceEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccc
Q 001655 864 VEILDD-DIYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGV 942 (1036)
Q Consensus 864 ~~~l~~-~~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~Gs 942 (1036)
+.|=.+ ++++.+|.+|.++++..++. +|......|-+-.+ +..-+ | .....++.++.+|.
T Consensus 438 v~fSpDG~~l~SGdsdG~v~~wdwkt~--------kl~~~lkah~~~ci-----~v~wH--P----~e~Skvat~~w~G~ 498 (503)
T KOG0282|consen 438 VDFSPDGRTLCSGDSDGKVNFWDWKTT--------KLVSKLKAHDQPCI-----GVDWH--P----VEPSKVATCGWDGL 498 (503)
T ss_pred EEEcCCCCeEEeecCCccEEEeechhh--------hhhhccccCCcceE-----EEEec--C----CCcceeEecccCce
Confidence 555444 45678999999999998752 44444444422212 11111 1 12346777788888
Q ss_pred eEE
Q 001655 943 IGV 945 (1036)
Q Consensus 943 Ig~ 945 (1036)
|.+
T Consensus 499 Iki 501 (503)
T KOG0282|consen 499 IKI 501 (503)
T ss_pred eEe
Confidence 764
No 53
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=95.20 E-value=1.3 Score=52.60 Aligned_cols=111 Identities=14% Similarity=0.123 Sum_probs=75.6
Q ss_pred cEEEEEeCCCEEEEEE-cCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCC
Q 001655 438 SVNVATANASQVLLAT-GGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDL 516 (1036)
Q Consensus 438 ~I~~as~~~~~vvv~~-~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l 516 (1036)
.|...+.+.++.+++. -+.++.+=++...+ -+.-+.-..-|+|+++.|+++ .|++=|+- |+.++||++++.
T Consensus 371 DILDlSWSKn~fLLSSSMDKTVRLWh~~~~~--CL~~F~HndfVTcVaFnPvDD-----ryFiSGSL-D~KvRiWsI~d~ 442 (712)
T KOG0283|consen 371 DILDLSWSKNNFLLSSSMDKTVRLWHPGRKE--CLKVFSHNDFVTCVAFNPVDD-----RYFISGSL-DGKVRLWSISDK 442 (712)
T ss_pred hheecccccCCeeEeccccccEEeecCCCcc--eeeEEecCCeeEEEEecccCC-----CcEeeccc-ccceEEeecCcC
Confidence 5777776655555544 35666554543211 122233456699999999764 57777877 999999999998
Q ss_pred CeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEec
Q 001655 517 NLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 517 ~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
+++.-..+. -+..++++.+ +..+.+||+-+|....|....
T Consensus 443 ~Vv~W~Dl~--~lITAvcy~P--dGk~avIGt~~G~C~fY~t~~ 482 (712)
T KOG0283|consen 443 KVVDWNDLR--DLITAVCYSP--DGKGAVIGTFNGYCRFYDTEG 482 (712)
T ss_pred eeEeehhhh--hhheeEEecc--CCceEEEEEeccEEEEEEccC
Confidence 887644444 2445666554 467899999999999998653
No 54
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=95.15 E-value=5.9 Score=42.87 Aligned_cols=240 Identities=15% Similarity=0.167 Sum_probs=116.3
Q ss_pred EEEeCCCEEEEEEcCCeEEEEEE-cCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCee
Q 001655 441 VATANASQVLLATGGGHLVYLEI-GDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLI 519 (1036)
Q Consensus 441 ~as~~~~~vvv~~~~~~~~~l~~-~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v 519 (1036)
+++..++.++++.++| +.+++. +......+.+. ..|+-+...+ + .+. ++... ++.+.+|+++.+...
T Consensus 2 c~~~~~~~L~vGt~~G-l~~~~~~~~~~~~~i~~~---~~I~ql~vl~--~----~~~-llvLs-d~~l~~~~L~~l~~~ 69 (275)
T PF00780_consen 2 CADSWGDRLLVGTEDG-LYVYDLSDPSKPTRILKL---SSITQLSVLP--E----LNL-LLVLS-DGQLYVYDLDSLEPV 69 (275)
T ss_pred CcccCCCEEEEEECCC-EEEEEecCCccceeEeec---ceEEEEEEec--c----cCE-EEEEc-CCccEEEEchhhccc
Confidence 3455678899998777 444566 22222222111 1155554422 1 122 33334 799999999887654
Q ss_pred EEe-------------cCCCccCceeEE-eeeecCeEEEEEEeCCCcEEEEEEecCCCcc-ccceeeecCccceEEEEEE
Q 001655 520 TKE-------------HLGGEIIPRSVL-LCAFEGISYLLCALGDGHLLNFLLNMKTGEL-TDRKKVSLGTQPITLRTFS 584 (1036)
Q Consensus 520 ~~~-------------~l~~~~~p~si~-~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l-~~~~~~~lG~~pv~l~~~~ 584 (1036)
... .++...-..... .....+...|.++.+. .+..|++....... +..+...+-..|..+.-+
T Consensus 70 ~~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va~kk-~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~~- 147 (275)
T PF00780_consen 70 STSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVAVKK-KILIYEWNDPRNSFSKLLKEISLPDPPSSIAFL- 147 (275)
T ss_pred cccccccccccccccccccccCCeeEEeeccccccceEEEEEECC-EEEEEEEECCcccccceeEEEEcCCCcEEEEEe-
Confidence 321 111000111111 0122355678888877 78889988743334 444555566666555443
Q ss_pred eCCceEEEEEcCCceEEEecC-CcEE-Eeeeccccc------eeeecccCCCCC--CeEEEEeCCeEEEEEEcCCCCeEE
Q 001655 585 SKNTTHVFAASDRPTVIYSSN-KKLL-YSNVNLKEV------SHMCPFNSAAFP--DSLAIAKEGELTIGTIDDIQKLHI 654 (1036)
Q Consensus 585 ~~~~~~v~~~~~~p~~i~~~~-~~~~-~~~~~~~~i------~~~~~f~~~~~~--~~l~~~~~~~l~i~~l~~~~~~~~ 654 (1036)
.+.+++...+-+.++.-+ +... +.+...... ....|......+ +.|++.++-++.+..-.. ....
T Consensus 148 ---~~~i~v~~~~~f~~idl~~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~e~Ll~~~~~g~fv~~~G~--~~r~ 222 (275)
T PF00780_consen 148 ---GNKICVGTSKGFYLIDLNTGSPSELLDPSDSSSSFKSRNSSSKPLGIFQLSDNEFLLCYDNIGVFVNKNGE--PSRK 222 (275)
T ss_pred ---CCEEEEEeCCceEEEecCCCCceEEeCccCCcchhhhcccCCCceEEEEeCCceEEEEecceEEEEcCCCC--cCcc
Confidence 234444434444443322 2221 111111110 000011000111 122222222222222111 1113
Q ss_pred EEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCC
Q 001655 655 RSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDT 712 (1036)
Q Consensus 655 ~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~ 712 (1036)
..+.-...|+.++|... |+++..+. .+++.+..+.+.+..++++.
T Consensus 223 ~~i~W~~~p~~~~~~~p---yli~~~~~----------~iEV~~~~~~~lvQ~i~~~~ 267 (275)
T PF00780_consen 223 STIQWSSAPQSVAYSSP---YLIAFSSN----------SIEVRSLETGELVQTIPLPN 267 (275)
T ss_pred cEEEcCCchhEEEEECC---EEEEECCC----------EEEEEECcCCcEEEEEECCC
Confidence 46777889999999764 66666542 58888888887777666543
No 55
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=95.03 E-value=6.5 Score=42.65 Aligned_cols=228 Identities=17% Similarity=0.236 Sum_probs=129.9
Q ss_pred EEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEec-
Q 001655 692 HFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETK- 770 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~- 770 (1036)
-.+++++-+...+|..+.|+. ++..+++. ++-++|.-. +.||+|++++ ++++|..+..
T Consensus 68 r~Lkv~~~Kk~~~ICe~~fpt-----~IL~VrmN---r~RLvV~Le-----------e~IyIydI~~--MklLhTI~t~~ 126 (391)
T KOG2110|consen 68 RKLKVVHFKKKTTICEIFFPT-----SILAVRMN---RKRLVVCLE-----------ESIYIYDIKD--MKLLHTIETTP 126 (391)
T ss_pred ceEEEEEcccCceEEEEecCC-----ceEEEEEc---cceEEEEEc-----------ccEEEEeccc--ceeehhhhccC
Confidence 478899888888888888874 45556664 456666642 3599999976 5566655432
Q ss_pred Cc---eeEeccccC--eEEEEE---CCEEEEEEeeecCCCccchhcc---cccccceEEEEEEEeCCEEEEEeccccEEE
Q 001655 771 GA---VYSLNAFNG--KLLAAI---NQKIQLYKWMLRDDGTRELQSE---CGHHGHILALYVQTRGDFIVVGDLMKSISL 839 (1036)
Q Consensus 771 g~---v~~i~~~~g--~Lv~~~---g~~l~v~~~~~~~~~~~~L~~~---~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~ 839 (1036)
-- +-|+..-++ +|.+-. ...|++|+.. .|++. ..+++...++.+...|.+|..+- -+|-.+
T Consensus 127 ~n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~-------nl~~v~~I~aH~~~lAalafs~~G~llATAS-eKGTVI 198 (391)
T KOG2110|consen 127 PNPKGLCALSPNNANCYLAYPGSTTSGDVVLFDTI-------NLQPVNTINAHKGPLAALAFSPDGTLLATAS-EKGTVI 198 (391)
T ss_pred CCccceEeeccCCCCceEEecCCCCCceEEEEEcc-------cceeeeEEEecCCceeEEEECCCCCEEEEec-cCceEE
Confidence 22 334333332 565532 2467887753 23333 23445555666666777655433 344322
Q ss_pred EEEe-ccCCeEEEEeccCCcceeEEEEEeeCceEE-EEccCCcEEEEeeCCCCCC------ccc--ccceeEEEEEEcCC
Q 001655 840 LIYK-HEEGAIEERARDYNANWMSAVEILDDDIYL-GAENNFNLFTVRKNSEGAT------DEE--RGRLEVVGEYHLGE 909 (1036)
Q Consensus 840 ~~~~-~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l-~~D~~gnl~~l~~~~~~~~------~~~--~~~L~~~~~~~lg~ 909 (1036)
=-|. ++..++.++-|-..+..+.+..|=.+..+| ++-..+.+++|+......+ ... ..++...+.-+++.
T Consensus 199 RVf~v~~G~kl~eFRRG~~~~~IySL~Fs~ds~~L~~sS~TeTVHiFKL~~~~~~~~~~p~~~~~~~~~~sk~~~sylps 278 (391)
T KOG2110|consen 199 RVFSVPEGQKLYEFRRGTYPVSIYSLSFSPDSQFLAASSNTETVHIFKLEKVSNNPPESPTAGTSWFGKVSKAATSYLPS 278 (391)
T ss_pred EEEEcCCccEeeeeeCCceeeEEEEEEECCCCCeEEEecCCCeEEEEEecccccCCCCCCCCCCcccchhhhhhhhhcch
Confidence 2233 456778888888888888888876555565 4556899999998542211 100 11121111115666
Q ss_pred ccceEEe--eeeee-cCCCC---------CCCCcceEEEEccccceEEEEe
Q 001655 910 FVNRFRH--GSLVM-RLPDS---------DVGQIPTVIFGTVNGVIGVIAS 948 (1036)
Q Consensus 910 ~v~~~~~--~~l~~-~~~~~---------~~~~~~~il~~t~~GsIg~l~~ 948 (1036)
.|.++.- .++.. .-+.+ .....+.+..+|.||-++.+.-
T Consensus 279 ~V~~~~~~~R~FAt~~l~~s~~~~~~~l~~~~~~~~v~vas~dG~~y~y~l 329 (391)
T KOG2110|consen 279 QVSSVLDQSRKFATAKLPESGRKNICSLSSIQKIPRVLVASYDGHLYSYRL 329 (391)
T ss_pred hhhhhhhhccceeEEEccCCCccceEEeeccCCCCEEEEEEcCCeEEEEEc
Confidence 6655411 01110 00111 1124578888999999997653
No 56
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=94.94 E-value=6.4 Score=45.52 Aligned_cols=74 Identities=12% Similarity=0.243 Sum_probs=54.7
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
+..|-|+++.| ...+++.+++ +|.++||+-++...+-+.... +.+.++..++ ..+.++++|..|+++-+|
T Consensus 13 SdRVKsVd~HP------tePw~la~Ly-nG~V~IWnyetqtmVksfeV~-~~PvRa~kfi--aRknWiv~GsDD~~IrVf 82 (794)
T KOG0276|consen 13 SDRVKSVDFHP------TEPWILAALY-NGDVQIWNYETQTMVKSFEVS-EVPVRAAKFI--ARKNWIVTGSDDMQIRVF 82 (794)
T ss_pred CCceeeeecCC------CCceEEEeee-cCeeEEEecccceeeeeeeec-ccchhhheee--eccceEEEecCCceEEEE
Confidence 35678999876 3678899999 999999998876665543333 2344555443 246899999999999999
Q ss_pred EEec
Q 001655 557 LLNM 560 (1036)
Q Consensus 557 ~~~~ 560 (1036)
+...
T Consensus 83 nynt 86 (794)
T KOG0276|consen 83 NYNT 86 (794)
T ss_pred eccc
Confidence 8764
No 57
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=94.80 E-value=5.7 Score=44.52 Aligned_cols=191 Identities=14% Similarity=0.086 Sum_probs=115.9
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCC-eEeEEEEEEEcCCCceEEEEEeeeeCC
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFE-YGCSILSCSFSDDSNVYYCVGTAYVLP 741 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E-~v~si~~~~l~~~~~~~i~VGT~~~~~ 741 (1036)
.+.+-|+|..++.++.+++. ..+++.|..+-.+ .+++..+| .+-|.... .. ..+++|-.+
T Consensus 113 v~~~~f~~~d~t~l~s~sDd---------~v~k~~d~s~a~v--~~~l~~htDYVR~g~~~---~~-~~hivvtGs---- 173 (487)
T KOG0310|consen 113 VHVTKFSPQDNTMLVSGSDD---------KVVKYWDLSTAYV--QAELSGHTDYVRCGDIS---PA-NDHIVVTGS---- 173 (487)
T ss_pred eeEEEecccCCeEEEecCCC---------ceEEEEEcCCcEE--EEEecCCcceeEeeccc---cC-CCeEEEecC----
Confidence 34556788888888887653 4667777766654 55555554 34444332 22 334444332
Q ss_pred CCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccC--eEEEEECCEEEEEEeeecCCCccchhcccccccceEEE
Q 001655 742 EENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNG--KLLAAINQKIQLYKWMLRDDGTRELQSECGHHGHILAL 819 (1036)
Q Consensus 742 ~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g--~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~ 819 (1036)
.-|.|.+|+..-.. ..+.+.+..-||-+++.+.+ .|+.|-|+.+++|++. .|.+.+.....+.-.+..+
T Consensus 174 -----YDg~vrl~DtR~~~-~~v~elnhg~pVe~vl~lpsgs~iasAgGn~vkVWDl~---~G~qll~~~~~H~KtVTcL 244 (487)
T KOG0310|consen 174 -----YDGKVRLWDTRSLT-SRVVELNHGCPVESVLALPSGSLIASAGGNSVKVWDLT---TGGQLLTSMFNHNKTVTCL 244 (487)
T ss_pred -----CCceEEEEEeccCC-ceeEEecCCCceeeEEEcCCCCEEEEcCCCeEEEEEec---CCceehhhhhcccceEEEE
Confidence 45889999886433 56777888999999999954 4556777999998763 2434443333333333344
Q ss_pred EEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCc-eEEEEccCCcEEEEe
Q 001655 820 YVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDD-IYLGAENNFNLFTVR 885 (1036)
Q Consensus 820 ~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~-~~l~~D~~gnl~~l~ 885 (1036)
.+...+.+++.|-+-+-|-++. ..+.+++- .=..|-.+.++..-+++ +++++=.+|-+.+-+
T Consensus 245 ~l~s~~~rLlS~sLD~~VKVfd--~t~~Kvv~--s~~~~~pvLsiavs~dd~t~viGmsnGlv~~rr 307 (487)
T KOG0310|consen 245 RLASDSTRLLSGSLDRHVKVFD--TTNYKVVH--SWKYPGPVLSIAVSPDDQTVVIGMSNGLVSIRR 307 (487)
T ss_pred EeecCCceEeecccccceEEEE--ccceEEEE--eeecccceeeEEecCCCceEEEecccceeeeeh
Confidence 4455567999999999888764 34444433 22334446666555554 444554566666553
No 58
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=94.70 E-value=1.3 Score=49.43 Aligned_cols=184 Identities=14% Similarity=0.127 Sum_probs=103.1
Q ss_pred eEEEEeCCeEEEEEEcCCC-CeEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE
Q 001655 632 SLAIAKEGELTIGTIDDIQ-KLHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP 709 (1036)
Q Consensus 632 ~l~~~~~~~l~i~~l~~~~-~~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~ 709 (1036)
+++.++++.=.+.++.+.+ ++..|+..=. .|...+.|.- +..|+...+. .+.|-+..-+|..--..+.
T Consensus 91 S~y~~sgG~~~~Vkiwdl~~kl~hr~lkdh~stvt~v~YN~-~DeyiAsvs~---------gGdiiih~~~t~~~tt~f~ 160 (673)
T KOG4378|consen 91 SLYEISGGQSGCVKIWDLRAKLIHRFLKDHQSTVTYVDYNN-TDEYIASVSD---------GGDIIIHGTKTKQKTTTFT 160 (673)
T ss_pred ceeeeccCcCceeeehhhHHHHHhhhccCCcceeEEEEecC-CcceeEEecc---------CCcEEEEecccCcccccee
Confidence 4556666555555666554 4444444321 3445555542 2334433321 2345555555544444455
Q ss_pred CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEec--cccCeEEEEE
Q 001655 710 LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLN--AFNGKLLAAI 787 (1036)
Q Consensus 710 ~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~--~~~g~Lv~~~ 787 (1036)
.+.+..+ ..+.+..- +.+++ |++ ...|-+.+|++...+-..-....++.|...|| +.+..|++++
T Consensus 161 ~~sgqsv---Rll~ys~s-kr~lL-~~a--------sd~G~VtlwDv~g~sp~~~~~~~HsAP~~gicfspsne~l~vsV 227 (673)
T KOG4378|consen 161 IDSGQSV---RLLRYSPS-KRFLL-SIA--------SDKGAVTLWDVQGMSPIFHASEAHSAPCRGICFSPSNEALLVSV 227 (673)
T ss_pred cCCCCeE---EEeecccc-cceee-Eee--------ccCCeEEEEeccCCCcccchhhhccCCcCcceecCCccceEEEe
Confidence 5555554 23333322 23333 333 25699999999754443333444455555444 5588999888
Q ss_pred C--CEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEe
Q 001655 788 N--QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYK 843 (1036)
Q Consensus 788 g--~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~ 843 (1036)
| .+|++|+. +.+++...-.|..+..++.+.-+|-++.+|...--+.+|-.+
T Consensus 228 G~Dkki~~yD~-----~s~~s~~~l~y~~Plstvaf~~~G~~L~aG~s~G~~i~YD~R 280 (673)
T KOG4378|consen 228 GYDKKINIYDI-----RSQASTDRLTYSHPLSTVAFSECGTYLCAGNSKGELIAYDMR 280 (673)
T ss_pred cccceEEEeec-----ccccccceeeecCCcceeeecCCceEEEeecCCceEEEEecc
Confidence 8 67777774 455665555566676677777778788888888877654333
No 59
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=94.70 E-value=0.69 Score=51.41 Aligned_cols=220 Identities=12% Similarity=0.122 Sum_probs=131.1
Q ss_pred CeEEEEe-CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCC-CEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEE
Q 001655 631 DSLAIAK-EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQS-RTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTY 708 (1036)
Q Consensus 631 ~~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~-~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~ 708 (1036)
..|+.++ +..+++--.+ ..-...+..++..|..+-++|+. +.|+++.+. +.|+..|-.+.+++..|
T Consensus 271 ~~fLS~sfD~~lKlwDtE--TG~~~~~f~~~~~~~cvkf~pd~~n~fl~G~sd----------~ki~~wDiRs~kvvqeY 338 (503)
T KOG0282|consen 271 TSFLSASFDRFLKLWDTE--TGQVLSRFHLDKVPTCVKFHPDNQNIFLVGGSD----------KKIRQWDIRSGKVVQEY 338 (503)
T ss_pred Ceeeeeecceeeeeeccc--cceEEEEEecCCCceeeecCCCCCcEEEEecCC----------CcEEEEeccchHHHHHH
Confidence 3444444 4445443332 34567889999999999999988 888888775 47888888887766544
Q ss_pred ECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEE-EEecCceeEeccccCeEEE-
Q 001655 709 PLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAE-KETKGAVYSLNAFNGKLLA- 785 (1036)
Q Consensus 709 ~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~-~~~~g~v~~i~~~~g~Lv~- 785 (1036)
. ++.-++..++|-.+++.|+- |+ + -+.+.+|+..-. .++.+.. ..+.-|..++.+.++.+++
T Consensus 339 d----~hLg~i~~i~F~~~g~rFis--sS-----D----dks~riWe~~~~v~ik~i~~~~~hsmP~~~~~P~~~~~~aQ 403 (503)
T KOG0282|consen 339 D----RHLGAILDITFVDEGRRFIS--SS-----D----DKSVRIWENRIPVPIKNIADPEMHTMPCLTLHPNGKWFAAQ 403 (503)
T ss_pred H----hhhhheeeeEEccCCceEee--ec-----c----CccEEEEEcCCCccchhhcchhhccCcceecCCCCCeehhh
Confidence 2 44456666677665565543 21 1 237788887632 3444443 3345666666766666554
Q ss_pred EECCEEEEEEeeecCCCccchhcccccccc---eEEEEEE--EeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcce
Q 001655 786 AINQKIQLYKWMLRDDGTRELQSECGHHGH---ILALYVQ--TRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANW 860 (1036)
Q Consensus 786 ~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~---~~~~~l~--~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~ 860 (1036)
++++.+.+|...++ .++.++-.+..+ -+++.+. -.|.+++-||.--.+.++.|+.. ++.-.-+-. ..-
T Consensus 404 s~dN~i~ifs~~~~----~r~nkkK~feGh~vaGys~~v~fSpDG~~l~SGdsdG~v~~wdwkt~--kl~~~lkah-~~~ 476 (503)
T KOG0282|consen 404 SMDNYIAIFSTVPP----FRLNKKKRFEGHSVAGYSCQVDFSPDGRTLCSGDSDGKVNFWDWKTT--KLVSKLKAH-DQP 476 (503)
T ss_pred ccCceEEEEecccc----cccCHhhhhcceeccCceeeEEEcCCCCeEEeecCCccEEEeechhh--hhhhccccC-Ccc
Confidence 67789999886432 223222122222 3455544 35789999999999998877642 221111111 122
Q ss_pred eEEEEEeeC--ceEEEEccCCcEEEE
Q 001655 861 MSAVEILDD--DIYLGAENNFNLFTV 884 (1036)
Q Consensus 861 ~~~~~~l~~--~~~l~~D~~gnl~~l 884 (1036)
|+.+..-.. ..++.++-+|-|.++
T Consensus 477 ci~v~wHP~e~Skvat~~w~G~Ikiw 502 (503)
T KOG0282|consen 477 CIGVDWHPVEPSKVATCGWDGLIKIW 502 (503)
T ss_pred eEEEEecCCCcceeEecccCceeEec
Confidence 333333322 357778888877654
No 60
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=94.69 E-value=12 Score=44.30 Aligned_cols=118 Identities=17% Similarity=0.221 Sum_probs=76.5
Q ss_pred EEEEEE--EEecCceeEeccc-cCeE-EEE-ECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccc
Q 001655 761 LQLIAE--KETKGAVYSLNAF-NGKL-LAA-INQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMK 835 (1036)
Q Consensus 761 l~~~~~--~~~~g~v~~i~~~-~g~L-v~~-~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~ 835 (1036)
|++.+. .+++.-|.|+..- +|++ +++ .++++.+|-++. -+-.+..=.+..|+..+.|+...+.|+.|-+-+
T Consensus 497 lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDt----lKFflsLYGHkLPV~smDIS~DSklivTgSADK 572 (888)
T KOG0306|consen 497 LSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDT----LKFFLSLYGHKLPVLSMDISPDSKLIVTGSADK 572 (888)
T ss_pred eeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEecc----eeeeeeecccccceeEEeccCCcCeEEeccCCC
Confidence 555444 4667888888765 4554 444 568999998741 111222233445566667777788999999999
Q ss_pred cEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCce-EEEEccCCcEEEEe
Q 001655 836 SISLLIYKHEEGAIEERARDYNANWMSAVEILDDDI-YLGAENNFNLFTVR 885 (1036)
Q Consensus 836 Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~-~l~~D~~gnl~~l~ 885 (1036)
.|.++..+..+=.-..+|.| -.++++.|+.++. ++.+-++|-+--+.
T Consensus 573 nVKiWGLdFGDCHKS~fAHd---DSvm~V~F~P~~~~FFt~gKD~kvKqWD 620 (888)
T KOG0306|consen 573 NVKIWGLDFGDCHKSFFAHD---DSVMSVQFLPKTHLFFTCGKDGKVKQWD 620 (888)
T ss_pred ceEEeccccchhhhhhhccc---CceeEEEEcccceeEEEecCcceEEeec
Confidence 99988766543222333433 3578899998654 67787888876553
No 61
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=94.68 E-value=1 Score=45.77 Aligned_cols=118 Identities=17% Similarity=0.248 Sum_probs=82.8
Q ss_pred CeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCce
Q 001655 651 KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNV 730 (1036)
Q Consensus 651 ~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~ 730 (1036)
..-++++.+...++.+-++++.+.+.++. .++|.|.|+++++.+.+|+++-+= .+.+|.. +++
T Consensus 175 gt~v~sL~~~s~VtSlEvs~dG~ilTia~-----------gssV~Fwdaksf~~lKs~k~P~nV-----~SASL~P-~k~ 237 (334)
T KOG0278|consen 175 GTEVQSLEFNSPVTSLEVSQDGRILTIAY-----------GSSVKFWDAKSFGLLKSYKMPCNV-----ESASLHP-KKE 237 (334)
T ss_pred CcEEEEEecCCCCcceeeccCCCEEEEec-----------CceeEEeccccccceeeccCcccc-----ccccccC-CCc
Confidence 34678888999999999998877555443 368999999999999998887543 3334433 346
Q ss_pred EEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEEEEecCceeEeccccCeEEEEECC---EEEEEEe
Q 001655 731 YYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAEKETKGAVYSLNAFNGKLLAAINQ---KIQLYKW 796 (1036)
Q Consensus 731 ~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~---~l~v~~~ 796 (1036)
+++-|. |+ +.+|.|+...+ .+.. +.+...|||.|+.--.+..++|.|+ +|+++..
T Consensus 238 ~fVaGg------ed----~~~~kfDy~TgeEi~~-~nkgh~gpVhcVrFSPdGE~yAsGSEDGTirlWQt 296 (334)
T KOG0278|consen 238 FFVAGG------ED----FKVYKFDYNTGEEIGS-YNKGHFGPVHCVRFSPDGELYASGSEDGTIRLWQT 296 (334)
T ss_pred eEEecC------cc----eEEEEEeccCCceeee-cccCCCCceEEEEECCCCceeeccCCCceEEEEEe
Confidence 666663 32 67777777633 3332 4577899999999776666777774 6777554
No 62
>PF00780 CNH: CNH domain; InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []: Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1. This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=94.68 E-value=7.7 Score=41.96 Aligned_cols=221 Identities=18% Similarity=0.137 Sum_probs=115.6
Q ss_pred CeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccce-EEEEEEeCCceEEEEEcCCceEEEecC---CcE-----EE
Q 001655 540 GISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPI-TLRTFSSKNTTHVFAASDRPTVIYSSN---KKL-----LY 610 (1036)
Q Consensus 540 ~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv-~l~~~~~~~~~~v~~~~~~p~~i~~~~---~~~-----~~ 610 (1036)
.+..|++|+.+| |+.|+...... .+......+| ++..+ ...+.+++.+++-..++.-+ ... ..
T Consensus 6 ~~~~L~vGt~~G-l~~~~~~~~~~-----~~~i~~~~~I~ql~vl--~~~~~llvLsd~~l~~~~L~~l~~~~~~~~~~~ 77 (275)
T PF00780_consen 6 WGDRLLVGTEDG-LYVYDLSDPSK-----PTRILKLSSITQLSVL--PELNLLLVLSDGQLYVYDLDSLEPVSTSAPLAF 77 (275)
T ss_pred CCCEEEEEECCC-EEEEEecCCcc-----ceeEeecceEEEEEEe--cccCEEEEEcCCccEEEEchhhccccccccccc
Confidence 467899999999 88888821111 1111222222 22222 23456777777554444211 000 00
Q ss_pred -------eeec-cccceeeecccCCCCC-CeEEEEeCCeEEEEEEcCC-CC--eEEEEEeCCCccceEEEecCCCEEEEE
Q 001655 611 -------SNVN-LKEVSHMCPFNSAAFP-DSLAIAKEGELTIGTIDDI-QK--LHIRSIPLGEHPRRICHQEQSRTFAIC 678 (1036)
Q Consensus 611 -------~~~~-~~~i~~~~~f~~~~~~-~~l~~~~~~~l~i~~l~~~-~~--~~~~~i~l~~tp~~i~y~~~~~~~~v~ 678 (1036)
..+. .+.+..++.- ..... ..++++.+..+.+.+.... .+ -..+.+.+.++|+.+++. .+.++|+
T Consensus 78 ~~~~~~~~~~~~~~~v~~f~~~-~~~~~~~~L~va~kk~i~i~~~~~~~~~f~~~~ke~~lp~~~~~i~~~--~~~i~v~ 154 (275)
T PF00780_consen 78 PKSRSLPTKLPETKGVSFFAVN-GGHEGSRRLCVAVKKKILIYEWNDPRNSFSKLLKEISLPDPPSSIAFL--GNKICVG 154 (275)
T ss_pred cccccccccccccCCeeEEeec-cccccceEEEEEECCEEEEEEEECCcccccceeEEEEcCCCcEEEEEe--CCEEEEE
Confidence 0111 1234444401 11111 2466677889999999874 33 478999999999999998 4566776
Q ss_pred EeecCCCCCceeeEEEEEEeCCCceEEEEEECC--------CCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceE
Q 001655 679 SLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD--------TFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGR 750 (1036)
Q Consensus 679 ~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~--------~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gr 750 (1036)
+.+ ...++|..+.....-+... ..+....+....+.+ .+++++-... |
T Consensus 155 ~~~-----------~f~~idl~~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~--~e~Ll~~~~~----------g- 210 (275)
T PF00780_consen 155 TSK-----------GFYLIDLNTGSPSELLDPSDSSSSFKSRNSSSKPLGIFQLSD--NEFLLCYDNI----------G- 210 (275)
T ss_pred eCC-----------ceEEEecCCCCceEEeCccCCcchhhhcccCCCceEEEEeCC--ceEEEEecce----------E-
Confidence 643 3455555444332222111 112222333344432 3555532111 1
Q ss_pred EEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEee
Q 001655 751 ILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWM 797 (1036)
Q Consensus 751 i~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~ 797 (1036)
+|-=.+++...-...+.++.+.+++....+|++...+.|.++++.
T Consensus 211 --~fv~~~G~~~r~~~i~W~~~p~~~~~~~pyli~~~~~~iEV~~~~ 255 (275)
T PF00780_consen 211 --VFVNKNGEPSRKSTIQWSSAPQSVAYSSPYLIAFSSNSIEVRSLE 255 (275)
T ss_pred --EEEcCCCCcCcccEEEcCCchhEEEEECCEEEEECCCEEEEEECc
Confidence 110002221112344567788888888889998888899998864
No 63
>PF14727 PHTB1_N: PTHB1 N-terminus
Probab=94.63 E-value=11 Score=43.23 Aligned_cols=125 Identities=22% Similarity=0.354 Sum_probs=77.1
Q ss_pred cceeeeeCCCCCcEEEEE---eC-CCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCC--CCCCcccEEE
Q 001655 426 ELRNEWKSPPGYSVNVAT---AN-ASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIG--ENPSYSQIAA 499 (1036)
Q Consensus 426 ~~~~~w~~~~~~~I~~as---~~-~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~--~~~~~~~~~~ 499 (1036)
+...+|...-|+.|.... .. ...-++++....+..+. ++|++.-+++ ++..++|+..-.+. ........++
T Consensus 228 ~l~~dWs~nlGE~~l~i~v~~~~~~~~~IvvLger~Lf~l~-~~G~l~~~kr--Ld~~p~~~~~Y~~~~~~~~~~~~~ll 304 (418)
T PF14727_consen 228 KLNPDWSFNLGEQALDIQVVRFSSSESDIVVLGERSLFCLK-DNGSLRFQKR--LDYNPSCFCPYRVPWYNEPSTRLNLL 304 (418)
T ss_pred cccceeEEECCceeEEEEEEEcCCCCceEEEEecceEEEEc-CCCeEEEEEe--cCCceeeEEEEEeecccCCCCceEEE
Confidence 355689877777655444 21 22223333345554443 3477766654 56777777532221 1111233588
Q ss_pred EEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeC-CCcEEEEEE
Q 001655 500 VGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALG-DGHLLNFLL 558 (1036)
Q Consensus 500 vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~-~G~l~~y~~ 558 (1036)
|++. ++.+.||+ +.+++|...++ ..|-++.+..+.+..-+++.+. +|.|-+.-+
T Consensus 305 V~t~-t~~LlVy~--d~~L~WsA~l~--~~PVal~v~~~~~~~G~IV~Ls~~G~L~v~YL 359 (418)
T PF14727_consen 305 VGTH-TGTLLVYE--DTTLVWSAQLP--HVPVALSVANFNGLKGLIVSLSDEGQLSVSYL 359 (418)
T ss_pred EEec-CCeEEEEe--CCeEEEecCCC--CCCEEEEecccCCCCceEEEEcCCCcEEEEEe
Confidence 8888 99999998 66778877775 5788888887776666677665 888876654
No 64
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=94.62 E-value=9.4 Score=42.60 Aligned_cols=231 Identities=14% Similarity=0.151 Sum_probs=114.5
Q ss_pred cCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCc-EEEEEEecCCCccccceeeecCccceEEEE
Q 001655 504 TDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGH-LLNFLLNMKTGELTDRKKVSLGTQPITLRT 582 (1036)
Q Consensus 504 ~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~-l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~ 582 (1036)
.+..|.+|+..+++.+....++. .|+-.. +..+..+.-+.||. |+++++++.+. +. .+-+....+ +..
T Consensus 75 ~~d~V~v~D~~t~~~~~~i~~p~--~p~~~~----~~~~~~~~ls~dgk~l~V~n~~p~~~-V~---VvD~~~~kv-v~e 143 (352)
T TIGR02658 75 RTDYVEVIDPQTHLPIADIELPE--GPRFLV----GTYPWMTSLTPDNKTLLFYQFSPSPA-VG---VVDLEGKAF-VRM 143 (352)
T ss_pred CCCEEEEEECccCcEEeEEccCC--Cchhhc----cCccceEEECCCCCEEEEecCCCCCE-EE---EEECCCCcE-EEE
Confidence 47899999999999887666652 333111 12355666777775 44455554321 11 011111111 122
Q ss_pred EEeCCceEEEEEcCCceEEEecCCcEEEeeecccc--ceeeec---------ccCC--CC-CCeEEEEe-CCeEEEEEEc
Q 001655 583 FSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKE--VSHMCP---------FNSA--AF-PDSLAIAK-EGELTIGTID 647 (1036)
Q Consensus 583 ~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~--i~~~~~---------f~~~--~~-~~~l~~~~-~~~l~i~~l~ 647 (1036)
+...+...++.+++.-.+..+.++++....+..+. ...-.+ |..+ .- .+..++++ ++.+.+..+.
T Consensus 144 i~vp~~~~vy~t~e~~~~~~~~Dg~~~~v~~d~~g~~~~~~~~vf~~~~~~v~~rP~~~~~dg~~~~vs~eG~V~~id~~ 223 (352)
T TIGR02658 144 MDVPDCYHIFPTANDTFFMHCRDGSLAKVGYGTKGNPKIKPTEVFHPEDEYLINHPAYSNKSGRLVWPTYTGKIFQIDLS 223 (352)
T ss_pred EeCCCCcEEEEecCCccEEEeecCceEEEEecCCCceEEeeeeeecCCccccccCCceEcCCCcEEEEecCCeEEEEecC
Confidence 22334555666665555555444443321111100 000001 1112 11 23455554 6777766653
Q ss_pred CCC---CeEEEEEeCCC-----ccce---EEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeE
Q 001655 648 DIQ---KLHIRSIPLGE-----HPRR---ICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYG 716 (1036)
Q Consensus 648 ~~~---~~~~~~i~l~~-----tp~~---i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v 716 (1036)
... .-....+..++ .|-. ++++++.+.+.|+...............|.++|..+++.+..+.... .+
T Consensus 224 ~~~~~~~~~~~~~~~~~~~~~wrP~g~q~ia~~~dg~~lyV~~~~~~~~thk~~~~~V~ViD~~t~kvi~~i~vG~--~~ 301 (352)
T TIGR02658 224 SGDAKFLPAIEAFTEAEKADGWRPGGWQQVAYHRARDRIYLLADQRAKWTHKTASRFLFVVDAKTGKRLRKIELGH--EI 301 (352)
T ss_pred CCcceecceeeeccccccccccCCCcceeEEEcCCCCEEEEEecCCccccccCCCCEEEEEECCCCeEEEEEeCCC--ce
Confidence 332 11112222211 1222 99999988888866432100001123589999999999999888754 33
Q ss_pred eEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC
Q 001655 717 CSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG 759 (1036)
Q Consensus 717 ~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~ 759 (1036)
..+ .+..+++.++.+-.. ..|.|.+++...+
T Consensus 302 ~~i---avS~Dgkp~lyvtn~---------~s~~VsViD~~t~ 332 (352)
T TIGR02658 302 DSI---NVSQDAKPLLYALST---------GDKTLYIFDAETG 332 (352)
T ss_pred eeE---EECCCCCeEEEEeCC---------CCCcEEEEECcCC
Confidence 333 455555545544331 3466888876544
No 65
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=94.44 E-value=2 Score=51.13 Aligned_cols=156 Identities=15% Similarity=0.138 Sum_probs=98.4
Q ss_pred CCccceEEEecCCCEEEEE-EeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeee
Q 001655 660 GEHPRRICHQEQSRTFAIC-SLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAY 738 (1036)
Q Consensus 660 ~~tp~~i~y~~~~~~~~v~-~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~ 738 (1036)
..-++.|+|+|--.-|.+. +.+ ..+||.+-...++++-++++ |.|++++.. . ..++.+|||
T Consensus 409 ndfVTcVaFnPvDDryFiSGSLD----------~KvRiWsI~d~~Vv~W~Dl~--~lITAvcy~---P-dGk~avIGt-- 470 (712)
T KOG0283|consen 409 NDFVTCVAFNPVDDRYFISGSLD----------GKVRLWSISDKKVVDWNDLR--DLITAVCYS---P-DGKGAVIGT-- 470 (712)
T ss_pred CCeeEEEEecccCCCcEeecccc----------cceEEeecCcCeeEeehhhh--hhheeEEec---c-CCceEEEEE--
Confidence 3455677888755544443 333 47888888778888777776 788877543 2 368999999
Q ss_pred eCCCCCCCcceEEEEEEEeCCeEEEEEE------EEe-cCceeEeccccC---eE-EEEECCEEEEEEeeecCCCccchh
Q 001655 739 VLPEENEPTKGRILVFIVEDGKLQLIAE------KET-KGAVYSLNAFNG---KL-LAAINQKIQLYKWMLRDDGTRELQ 807 (1036)
Q Consensus 739 ~~~~e~~~~~Gri~v~~i~~~kl~~~~~------~~~-~g~v~~i~~~~g---~L-v~~~g~~l~v~~~~~~~~~~~~L~ 807 (1036)
..|..++|...+.|+..-.. +.. .+.||.++.+-+ .+ |.+...+|+||+..+++ -..++.
T Consensus 471 --------~~G~C~fY~t~~lk~~~~~~I~~~~~Kk~~~~rITG~Q~~p~~~~~vLVTSnDSrIRI~d~~~~~-lv~KfK 541 (712)
T KOG0283|consen 471 --------FNGYCRFYDTEGLKLVSDFHIRLHNKKKKQGKRITGLQFFPGDPDEVLVTSNDSRIRIYDGRDKD-LVHKFK 541 (712)
T ss_pred --------eccEEEEEEccCCeEEEeeeEeeccCccccCceeeeeEecCCCCCeEEEecCCCceEEEeccchh-hhhhhc
Confidence 56899999998877653221 222 235999887732 35 45566899999963221 112332
Q ss_pred cccccccce-EEEEEEEeCCEEEEEeccccEEEEEEec
Q 001655 808 SECGHHGHI-LALYVQTRGDFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 808 ~~~~~~~~~-~~~~l~~~~~~I~vgD~~~Sv~~~~~~~ 844 (1036)
+ +..+.. .--++...|.+|+.|---..|++.+++.
T Consensus 542 G--~~n~~SQ~~Asfs~Dgk~IVs~seDs~VYiW~~~~ 577 (712)
T KOG0283|consen 542 G--FRNTSSQISASFSSDGKHIVSASEDSWVYIWKNDS 577 (712)
T ss_pred c--cccCCcceeeeEccCCCEEEEeecCceEEEEeCCC
Confidence 2 222222 1234566889999998666676665543
No 66
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=94.43 E-value=8.1 Score=41.04 Aligned_cols=254 Identities=15% Similarity=0.156 Sum_probs=114.9
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
..|+|++.+ ..+++-|.. |-.|+||+++.-..... -+........+.+..--+..+|+-|..||.++.++
T Consensus 44 ~sitavAVs--------~~~~aSGss-DetI~IYDm~k~~qlg~-ll~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~ 113 (362)
T KOG0294|consen 44 GSITALAVS--------GPYVASGSS-DETIHIYDMRKRKQLGI-LLSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWR 113 (362)
T ss_pred cceeEEEec--------ceeEeccCC-CCcEEEEeccchhhhcc-eeccccceEEEEecCCcchhheeeecCCCcEEEEE
Confidence 567888884 467666655 88999999986221100 00000111111111101234899999999999998
Q ss_pred EecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEec--CCcEEE-eeeccccceeeecccCCCCCCeEE
Q 001655 558 LNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSS--NKKLLY-SNVNLKEVSHMCPFNSAAFPDSLA 634 (1036)
Q Consensus 558 ~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~--~~~~~~-~~~~~~~i~~~~~f~~~~~~~~l~ 634 (1036)
..+= .-.++..--...|.-..++-.+.=++=+-+|... =.++ +||-.| .++ +.......|. .-++.|+
T Consensus 114 ~~~W----~~~~slK~H~~~Vt~lsiHPS~KLALsVg~D~~l-r~WNLV~Gr~a~v~~L--~~~at~v~w~--~~Gd~F~ 184 (362)
T KOG0294|consen 114 VGSW----ELLKSLKAHKGQVTDLSIHPSGKLALSVGGDQVL-RTWNLVRGRVAFVLNL--KNKATLVSWS--PQGDHFV 184 (362)
T ss_pred cCCe----EEeeeecccccccceeEecCCCceEEEEcCCcee-eeehhhcCccceeecc--CCcceeeEEc--CCCCEEE
Confidence 6531 1011111001112111111111112222222221 1111 222211 111 1111122222 2345688
Q ss_pred EEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCC
Q 001655 635 IAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFE 714 (1036)
Q Consensus 635 ~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E 714 (1036)
+.-.+.+-|.+++...-+ +.+....-+..+.+. +.+.++|+... ..+.+.|.++... -++|..+|
T Consensus 185 v~~~~~i~i~q~d~A~v~--~~i~~~~r~l~~~~l-~~~~L~vG~d~----------~~i~~~D~ds~~~--~~~~~AH~ 249 (362)
T KOG0294|consen 185 VSGRNKIDIYQLDNASVF--REIENPKRILCATFL-DGSELLVGGDN----------EWISLKDTDSDTP--LTEFLAHE 249 (362)
T ss_pred EEeccEEEEEecccHhHh--hhhhccccceeeeec-CCceEEEecCC----------ceEEEeccCCCcc--ceeeecch
Confidence 888999999999875311 111111112223333 33344444322 3567777655322 23454544
Q ss_pred e-EeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe---CCeEEEEEEEEecCceeEec
Q 001655 715 Y-GCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE---DGKLQLIAEKETKGAVYSLN 777 (1036)
Q Consensus 715 ~-v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~---~~kl~~~~~~~~~g~v~~i~ 777 (1036)
. |-.+... .++...|| +|+ .+-|.|.+|+++ +.+-+++...+.+...+|+.
T Consensus 250 ~RVK~i~~~--~~~~~~~l--vTa--------SSDG~I~vWd~~~~~k~~~~~l~e~n~~~RltCl~ 304 (362)
T KOG0294|consen 250 NRVKDIASY--TNPEHEYL--VTA--------SSDGFIKVWDIDMETKKRPTLLAELNTNVRLTCLR 304 (362)
T ss_pred hheeeeEEE--ecCCceEE--EEe--------ccCceEEEEEccccccCCcceeEEeecCCccceee
Confidence 3 4444433 22222333 344 256999999987 22345566555554444443
No 67
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=94.35 E-value=8.4 Score=40.88 Aligned_cols=185 Identities=14% Similarity=0.168 Sum_probs=102.1
Q ss_pred eEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCcc-CceeEEeeeecCeEEEEEEeCCCcEEEEEE
Q 001655 480 ISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEI-IPRSVLLCAFEGISYLLCALGDGHLLNFLL 558 (1036)
Q Consensus 480 is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~-~p~si~~~~~~~~~~L~vgl~~G~l~~y~~ 558 (1036)
..|+.+++ -+.++++|+. +|.+.||++.++.+-. -++... +..|++-.+ +...|+-+.+|-.+..+.+
T Consensus 26 a~~~~Fs~------~G~~lAvGc~-nG~vvI~D~~T~~iar--~lsaH~~pi~sl~WS~--dgr~LltsS~D~si~lwDl 94 (405)
T KOG1273|consen 26 AECCQFSR------WGDYLAVGCA-NGRVVIYDFDTFRIAR--MLSAHVRPITSLCWSR--DGRKLLTSSRDWSIKLWDL 94 (405)
T ss_pred cceEEecc------Ccceeeeecc-CCcEEEEEccccchhh--hhhccccceeEEEecC--CCCEeeeecCCceeEEEec
Confidence 34777754 3689999999 9999999998765411 111111 223443222 3456777888887777765
Q ss_pred ecCCCccccceeeecCccceEEEEEEeCCceEE--EEEcCCceEEEecCCcEEEeeeccc-cceeeec---ccCCCCCCe
Q 001655 559 NMKTGELTDRKKVSLGTQPITLRTFSSKNTTHV--FAASDRPTVIYSSNKKLLYSNVNLK-EVSHMCP---FNSAAFPDS 632 (1036)
Q Consensus 559 ~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v--~~~~~~p~~i~~~~~~~~~~~~~~~-~i~~~~~---f~~~~~~~~ 632 (1036)
-..+ .+. .+.+ ..||-.-.+.-...+.+ ...-..|.++..++++-.+.|.+.+ .....+. |+ .-++.
T Consensus 95 ~~gs-~l~---rirf-~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fd--r~g~y 167 (405)
T KOG1273|consen 95 LKGS-PLK---RIRF-DSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFD--RRGKY 167 (405)
T ss_pred cCCC-cee---EEEc-cCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCcccccccccccccc--CCCCE
Confidence 4332 111 1111 23332222211122222 3345668888776666556666532 2222222 22 12333
Q ss_pred EEE-EeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeec
Q 001655 633 LAI-AKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKN 682 (1036)
Q Consensus 633 l~~-~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~ 682 (1036)
++. .++|.+.+...++..=...-||..-...+.|.+....+.+++-|+++
T Consensus 168 IitGtsKGkllv~~a~t~e~vas~rits~~~IK~I~~s~~g~~liiNtsDR 218 (405)
T KOG1273|consen 168 IITGTSKGKLLVYDAETLECVASFRITSVQAIKQIIVSRKGRFLIINTSDR 218 (405)
T ss_pred EEEecCcceEEEEecchheeeeeeeechheeeeEEEEeccCcEEEEecCCc
Confidence 333 45788998888877544444555455667777777777777777654
No 68
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=94.31 E-value=3.9 Score=41.51 Aligned_cols=109 Identities=17% Similarity=0.278 Sum_probs=71.6
Q ss_pred CCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE-CCCCCeEeEEEEEEEcCCCceEEEEEee
Q 001655 659 LGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP-LDTFEYGCSILSCSFSDDSNVYYCVGTA 737 (1036)
Q Consensus 659 l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~-~~~~E~v~si~~~~l~~~~~~~i~VGT~ 737 (1036)
+|...+.+.++++.++..+.+.. +.++|+|..|++.+.+|. .+.-|.=+-++ |. +...+++-|.
T Consensus 182 ~g~pit~vs~s~d~nc~La~~l~----------stlrLlDk~tGklL~sYkGhkn~eykldc~---l~-qsdthV~sgS- 246 (307)
T KOG0316|consen 182 FGHPITSVSFSKDGNCSLASSLD----------STLRLLDKETGKLLKSYKGHKNMEYKLDCC---LN-QSDTHVFSGS- 246 (307)
T ss_pred cCCcceeEEecCCCCEEEEeecc----------ceeeecccchhHHHHHhcccccceeeeeee---ec-ccceeEEecc-
Confidence 45566788899999988888765 699999999999998776 33334322211 11 1233444332
Q ss_pred eeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecC-c-eeEeccc--cCeEEEEECCEEEE
Q 001655 738 YVLPEENEPTKGRILVFIVEDGKLQLIAEKETKG-A-VYSLNAF--NGKLLAAINQKIQL 793 (1036)
Q Consensus 738 ~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g-~-v~~i~~~--~g~Lv~~~g~~l~v 793 (1036)
.-|.+|+|++.+.++ +.+.++.+ + |+++... ...++.|.|+....
T Consensus 247 ---------EDG~Vy~wdLvd~~~--~sk~~~~~~v~v~dl~~hp~~~~f~~A~~~~~~~ 295 (307)
T KOG0316|consen 247 ---------EDGKVYFWDLVDETQ--ISKLSVVSTVIVTDLSCHPTMDDFITATGHGDLF 295 (307)
T ss_pred ---------CCceEEEEEecccee--eeeeccCCceeEEeeecccCccceeEecCCceec
Confidence 349999999987543 44445444 3 5666655 56788888887765
No 69
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=94.17 E-value=13 Score=42.39 Aligned_cols=135 Identities=19% Similarity=0.249 Sum_probs=76.8
Q ss_pred CCeEEEEe-cCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCce-eEEE
Q 001655 406 YNQLVQVT-SGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYE-ISCL 483 (1036)
Q Consensus 406 ~~~~vQVt-~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~-is~l 483 (1036)
++.++-.+ ...++.++.++++. .|..+.+. ....+..+..+++...++.+..++.++++..-.. ..+... .+..
T Consensus 241 ~~~vy~~~~~g~l~a~d~~tG~~--~W~~~~~~-~~~p~~~~~~vyv~~~~G~l~~~d~~tG~~~W~~-~~~~~~~~ssp 316 (377)
T TIGR03300 241 GGQVYAVSYQGRVAALDLRSGRV--LWKRDASS-YQGPAVDDNRLYVTDADGVVVALDRRSGSELWKN-DELKYRQLTAP 316 (377)
T ss_pred CCEEEEEEcCCEEEEEECCCCcE--EEeeccCC-ccCceEeCCEEEEECCCCeEEEEECCCCcEEEcc-ccccCCccccC
Confidence 34444444 34567777665443 36543221 2223355677777777788888887665432111 112211 1221
Q ss_pred EcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 484 DINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 484 ~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
.+ ....++++.. +|.+.+++..+.+.+++..+.......+..+. ...|++++.||.|++++
T Consensus 317 ~i--------~g~~l~~~~~-~G~l~~~d~~tG~~~~~~~~~~~~~~~sp~~~----~~~l~v~~~dG~l~~~~ 377 (377)
T TIGR03300 317 AV--------VGGYLVVGDF-EGYLHWLSREDGSFVARLKTDGSGIASPPVVV----GDGLLVQTRDGDLYAFR 377 (377)
T ss_pred EE--------ECCEEEEEeC-CCEEEEEECCCCCEEEEEEcCCCccccCCEEE----CCEEEEEeCCceEEEeC
Confidence 12 1457777776 89999999888888876655432111122222 24699999999998863
No 70
>PLN00181 protein SPA1-RELATED; Provisional
Probab=93.80 E-value=26 Score=44.53 Aligned_cols=218 Identities=15% Similarity=0.177 Sum_probs=111.8
Q ss_pred CCeEEEEEEcCCC------CeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 638 EGELTIGTIDDIQ------KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 638 ~~~l~i~~l~~~~------~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
++.+++-.+.... ..+...+.-......+++++..+.+++.+.. .+.|++.|..+.+.+..++-.
T Consensus 504 D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~---------Dg~v~lWd~~~~~~~~~~~~H 574 (793)
T PLN00181 504 NKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNF---------EGVVQVWDVARSQLVTEMKEH 574 (793)
T ss_pred CCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEeC---------CCeEEEEECCCCeEEEEecCC
Confidence 5667766654210 1122333333445667777654444444332 258999998888776655322
Q ss_pred CCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCe-EEEEE-
Q 001655 712 TFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGK-LLAAI- 787 (1036)
Q Consensus 712 ~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~-Lv~~~- 787 (1036)
...+.++ .+......+++.|. ..|.+.+|++..++. +......+.|.++.-. +|. |++|.
T Consensus 575 -~~~V~~l---~~~p~~~~~L~Sgs----------~Dg~v~iWd~~~~~~--~~~~~~~~~v~~v~~~~~~g~~latgs~ 638 (793)
T PLN00181 575 -EKRVWSI---DYSSADPTLLASGS----------DDGSVKLWSINQGVS--IGTIKTKANICCVQFPSESGRSLAFGSA 638 (793)
T ss_pred -CCCEEEE---EEcCCCCCEEEEEc----------CCCEEEEEECCCCcE--EEEEecCCCeEEEEEeCCCCCEEEEEeC
Confidence 2234444 33322346777775 347899999875432 2233345677777632 354 44433
Q ss_pred CCEEEEEEeeecCCCccchhcccccccceEEEEEEE-eCCEEEEEeccccEEEEEEecc-----CCeEEEEeccCCccee
Q 001655 788 NQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQT-RGDFIVVGDLMKSISLLIYKHE-----EGAIEERARDYNANWM 861 (1036)
Q Consensus 788 g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~-~~~~I~vgD~~~Sv~~~~~~~~-----~~~l~~~a~D~~~~~~ 861 (1036)
.+.|++|++.. +...+.....+... +.++.. .+++++.|..-..+.++..... ...+..+.. ....+
T Consensus 639 dg~I~iwD~~~---~~~~~~~~~~h~~~--V~~v~f~~~~~lvs~s~D~~ikiWd~~~~~~~~~~~~l~~~~g--h~~~i 711 (793)
T PLN00181 639 DHKVYYYDLRN---PKLPLCTMIGHSKT--VSYVRFVDSSTLVSSSTDNTLKLWDLSMSISGINETPLHSFMG--HTNVK 711 (793)
T ss_pred CCeEEEEECCC---CCccceEecCCCCC--EEEEEEeCCCEEEEEECCCEEEEEeCCCCccccCCcceEEEcC--CCCCe
Confidence 35788877531 11112111112222 233433 4678888877777777654321 112222221 12223
Q ss_pred EEEEEeeCc-eEEEEccCCcEEEEeeC
Q 001655 862 SAVEILDDD-IYLGAENNFNLFTVRKN 887 (1036)
Q Consensus 862 ~~~~~l~~~-~~l~~D~~gnl~~l~~~ 887 (1036)
..+.+-.++ .++++..+|.+.++...
T Consensus 712 ~~v~~s~~~~~lasgs~D~~v~iw~~~ 738 (793)
T PLN00181 712 NFVGLSVSDGYIATGSETNEVFVYHKA 738 (793)
T ss_pred eEEEEcCCCCEEEEEeCCCEEEEEECC
Confidence 333333233 45667778999998764
No 71
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=93.67 E-value=0.53 Score=49.20 Aligned_cols=270 Identities=18% Similarity=0.246 Sum_probs=146.3
Q ss_pred EEEEeCCC--ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCC-------CeEeEEEEEEE
Q 001655 654 IRSIPLGE--HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTF-------EYGCSILSCSF 724 (1036)
Q Consensus 654 ~~~i~l~~--tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~-------E~v~si~~~~l 724 (1036)
.|+|..|. -|....|+|+.+.++-.+.+ +.+++.|-.+++.-.....+.. ..+.|+. |
T Consensus 205 ~r~IKFg~KSh~EcA~FSPDgqyLvsgSvD----------GFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~---F 271 (508)
T KOG0275|consen 205 ARSIKFGQKSHVECARFSPDGQYLVSGSVD----------GFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCIS---F 271 (508)
T ss_pred hhheecccccchhheeeCCCCceEeecccc----------ceeeeehhccchhhhhhhhhhhcceeecccceEEEe---e
Confidence 45666653 46667788888755544432 4666666655554432222222 3344443 3
Q ss_pred cCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc--CeEE-EEECCEEEEEEeeecCC
Q 001655 725 SDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN--GKLL-AAINQKIQLYKWMLRDD 801 (1036)
Q Consensus 725 ~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~--g~Lv-~~~g~~l~v~~~~~~~~ 801 (1036)
.. ..++++-|. -.|.|.+|++..+..--.+.+.....|+|+.--+ ..|+ ++..++++++.+. .
T Consensus 272 SR-DsEMlAsGs----------qDGkIKvWri~tG~ClRrFdrAHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlK---S 337 (508)
T KOG0275|consen 272 SR-DSEMLASGS----------QDGKIKVWRIETGQCLRRFDRAHTKGVTCLSFSRDNSQILSASFDQTVRIHGLK---S 337 (508)
T ss_pred cc-cHHHhhccC----------cCCcEEEEEEecchHHHHhhhhhccCeeEEEEccCcchhhcccccceEEEeccc---c
Confidence 33 356666554 4589999999866544444455566788877543 3555 4455788898864 1
Q ss_pred Cccchhcccccccc-eEEEE--EEEeCCEEEEEeccccEEEEEEeccC--CeEEEEeccCCcceeEEEEEeeC--ceEEE
Q 001655 802 GTRELQSECGHHGH-ILALY--VQTRGDFIVVGDLMKSISLLIYKHEE--GAIEERARDYNANWMSAVEILDD--DIYLG 874 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~-~~~~~--l~~~~~~I~vgD~~~Sv~~~~~~~~~--~~l~~~a~D~~~~~~~~~~~l~~--~~~l~ 874 (1036)
| ++.+. ++++ +++.. .+..|++|+-+..--++.++.-+..+ ..+.+.+.|.. +.++..+.. ..+++
T Consensus 338 G--K~LKE--frGHsSyvn~a~ft~dG~~iisaSsDgtvkvW~~KtteC~~Tfk~~~~d~~---vnsv~~~PKnpeh~iV 410 (508)
T KOG0275|consen 338 G--KCLKE--FRGHSSYVNEATFTDDGHHIISASSDGTVKVWHGKTTECLSTFKPLGTDYP---VNSVILLPKNPEHFIV 410 (508)
T ss_pred c--hhHHH--hcCccccccceEEcCCCCeEEEecCCccEEEecCcchhhhhhccCCCCccc---ceeEEEcCCCCceEEE
Confidence 2 22221 2233 23322 34568899888877777765433221 23444454443 444555543 45899
Q ss_pred EccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEecChhHH
Q 001655 875 AENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASLPHEQY 954 (1036)
Q Consensus 875 ~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l~~~~~ 954 (1036)
+.+...++++....+.-.+. ..+.=.=|+.|++... ..+.=+.+.+.||-+|+|.-++-.
T Consensus 411 CNrsntv~imn~qGQvVrsf------sSGkREgGdFi~~~lS------------pkGewiYcigED~vlYCF~~~sG~-- 470 (508)
T KOG0275|consen 411 CNRSNTVYIMNMQGQVVRSF------SSGKREGGDFINAILS------------PKGEWIYCIGEDGVLYCFSVLSGK-- 470 (508)
T ss_pred EcCCCeEEEEeccceEEeee------ccCCccCCceEEEEec------------CCCcEEEEEccCcEEEEEEeecCc--
Confidence 99999999998754211100 0111123445544321 123345555777777777776532
Q ss_pred HHHHHHHHHHHhcccCCCCCCccccccc
Q 001655 955 LFLEKLQTNLRKVIKGVGGLNHEQWRSF 982 (1036)
Q Consensus 955 ~~L~~lq~~l~~~~~~~~gl~~~~~R~~ 982 (1036)
||+-|.-..+.+-|+.|--+++.
T Consensus 471 -----LE~tl~VhEkdvIGl~HHPHqNl 493 (508)
T KOG0275|consen 471 -----LERTLPVHEKDVIGLTHHPHQNL 493 (508)
T ss_pred -----eeeeeecccccccccccCcccch
Confidence 22223333344556666655553
No 72
>PF14727 PHTB1_N: PTHB1 N-terminus
Probab=93.47 E-value=17 Score=41.50 Aligned_cols=140 Identities=14% Similarity=0.172 Sum_probs=77.0
Q ss_pred CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecC-----------CCCCcee-eEEEEEEeCCCceEE
Q 001655 638 EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQ-----------SCAEESE-MHFVRLLDDQTFEFI 705 (1036)
Q Consensus 638 ~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~-----------~~~~~~~-~~~l~l~d~~t~~~i 705 (1036)
++.|.|..=+.. ...+.+|----|--++|.+.++.|+++.+.-. ..+.+.+ .....-.. ...+..
T Consensus 154 DG~L~~feqe~~--~f~~~lp~~llPgPl~Y~~~tDsfvt~sss~~l~~Yky~~La~~s~~~~~~~~~~~~~~-~~k~l~ 230 (418)
T PF14727_consen 154 DGSLSFFEQESF--AFSRFLPDFLLPGPLCYCPRTDSFVTASSSWTLECYKYQDLASASEASSRQSGTEQDIS-SGKKLN 230 (418)
T ss_pred CceEEEEeCCcE--EEEEEcCCCCCCcCeEEeecCCEEEEecCceeEEEecHHHhhhcccccccccccccccc-cccccc
Confidence 666666653321 12445555456777999999999988876420 0010000 00000000 111112
Q ss_pred EEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc-----
Q 001655 706 STYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN----- 780 (1036)
Q Consensus 706 ~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~----- 780 (1036)
..-.|.-+|.+..|..+++.......+|.|.. .+++++- ++ ++.+.+..+..+.|++.|.
T Consensus 231 ~dWs~nlGE~~l~i~v~~~~~~~~~IvvLger------------~Lf~l~~-~G--~l~~~krLd~~p~~~~~Y~~~~~~ 295 (418)
T PF14727_consen 231 PDWSFNLGEQALDIQVVRFSSSESDIVVLGER------------SLFCLKD-NG--SLRFQKRLDYNPSCFCPYRVPWYN 295 (418)
T ss_pred ceeEEECCceeEEEEEEEcCCCCceEEEEecc------------eEEEEcC-CC--eEEEEEecCCceeeEEEEEeeccc
Confidence 22356678999999998886544556666643 3333332 33 4455566677777777661
Q ss_pred --C----eEEEEECCEEEEEE
Q 001655 781 --G----KLLAAINQKIQLYK 795 (1036)
Q Consensus 781 --g----~Lv~~~g~~l~v~~ 795 (1036)
+ .|+++..+++.+|+
T Consensus 296 ~~~~~~~llV~t~t~~LlVy~ 316 (418)
T PF14727_consen 296 EPSTRLNLLVGTHTGTLLVYE 316 (418)
T ss_pred CCCCceEEEEEecCCeEEEEe
Confidence 1 45666778899988
No 73
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=93.47 E-value=14 Score=41.60 Aligned_cols=60 Identities=18% Similarity=0.209 Sum_probs=32.1
Q ss_pred ccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeee-cCeEEEEEEeCCCcEEEEEEe
Q 001655 495 SQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAF-EGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~-~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
+.+++-|-- ++.+.||+|.. ++++.. +. +.. ..+..+.. ....|+-.+.-.|.++.-.+.
T Consensus 91 S~y~~sgG~-~~~Vkiwdl~~-kl~hr~-lk-dh~-stvt~v~YN~~DeyiAsvs~gGdiiih~~~ 151 (673)
T KOG4378|consen 91 SLYEISGGQ-SGCVKIWDLRA-KLIHRF-LK-DHQ-STVTYVDYNNTDEYIASVSDGGDIIIHGTK 151 (673)
T ss_pred ceeeeccCc-CceeeehhhHH-HHHhhh-cc-CCc-ceeEEEEecCCcceeEEeccCCcEEEEecc
Confidence 455555545 78999999873 222211 11 111 12222222 245677777778888776554
No 74
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=93.35 E-value=8.3 Score=42.99 Aligned_cols=133 Identities=18% Similarity=0.188 Sum_probs=85.3
Q ss_pred eCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCC--
Q 001655 637 KEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFE-- 714 (1036)
Q Consensus 637 ~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E-- 714 (1036)
.+..+++-+++...++..+ +....+..++|..+. .|+.++. .+.|.|.+-.+++++.++....+-
T Consensus 306 rDrT~rlwKi~eesqlifr--g~~~sidcv~~In~~-HfvsGSd----------nG~IaLWs~~KKkplf~~~~AHgv~~ 372 (479)
T KOG0299|consen 306 RDRTVRLWKIPEESQLIFR--GGEGSIDCVAFINDE-HFVSGSD----------NGSIALWSLLKKKPLFTSRLAHGVIP 372 (479)
T ss_pred ccceeEEEeccccceeeee--CCCCCeeeEEEeccc-ceeeccC----------CceEEEeeecccCceeEeeccccccC
Confidence 4667777777654443222 224466666666443 2443332 367888888888888766543221
Q ss_pred ---------eEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC--eEEEEEEEEecCceeEeccc-cC-
Q 001655 715 ---------YGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG--KLQLIAEKETKGAVYSLNAF-NG- 781 (1036)
Q Consensus 715 ---------~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~--kl~~~~~~~~~g~v~~i~~~-~g- 781 (1036)
-++++..+ .+..+++-|. ..|.+.+|.+.++ +++++++..+.|-|.+++-. +|
T Consensus 373 ~~~~~~~~~Witsla~i----~~sdL~asGS----------~~G~vrLW~i~~g~r~i~~l~~ls~~GfVNsl~f~~sgk 438 (479)
T KOG0299|consen 373 ELDPVNGNFWITSLAVI----PGSDLLASGS----------WSGCVRLWKIEDGLRAINLLYSLSLVGFVNSLAFSNSGK 438 (479)
T ss_pred CccccccccceeeeEec----ccCceEEecC----------CCCceEEEEecCCccccceeeecccccEEEEEEEccCCC
Confidence 23333332 1234444443 6789999999976 89999999999999999944 55
Q ss_pred eEEEEECCEEEEEEe
Q 001655 782 KLLAAINQKIQLYKW 796 (1036)
Q Consensus 782 ~Lv~~~g~~l~v~~~ 796 (1036)
+|++++|+.=++=+|
T Consensus 439 ~ivagiGkEhRlGRW 453 (479)
T KOG0299|consen 439 RIVAGIGKEHRLGRW 453 (479)
T ss_pred EEEEeccccccccee
Confidence 499999986665455
No 75
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=93.33 E-value=1.6 Score=49.71 Aligned_cols=138 Identities=15% Similarity=0.153 Sum_probs=77.1
Q ss_pred EEEEEEcCCeEEEEEEcCcEEEEEEeccCC-ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecC--
Q 001655 448 QVLLATGGGHLVYLEIGDGILTEVKHAQLE-YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHL-- 524 (1036)
Q Consensus 448 ~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~-~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l-- 524 (1036)
..+++ ++.++.-|.++.|++. .++..+ .++.|+++++. ...+++|+. +|.++.|+-.+-+.+..-..
T Consensus 148 ly~~g-sg~evYRlNLEqGrfL--~P~~~~~~~lN~v~in~~------hgLla~Gt~-~g~VEfwDpR~ksrv~~l~~~~ 217 (703)
T KOG2321|consen 148 LYLVG-SGSEVYRLNLEQGRFL--NPFETDSGELNVVSINEE------HGLLACGTE-DGVVEFWDPRDKSRVGTLDAAS 217 (703)
T ss_pred EEEee-cCcceEEEEccccccc--cccccccccceeeeecCc------cceEEeccc-CceEEEecchhhhhheeeeccc
Confidence 44443 4666766666666542 223333 56677787653 568888988 99999998765433332111
Q ss_pred -----CC-c--cCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcC
Q 001655 525 -----GG-E--IIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASD 596 (1036)
Q Consensus 525 -----~~-~--~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~ 596 (1036)
+. + ..+.++.+- ++..++=||+++|.++.|.+......+ .....+..|+....+...+....+++.+
T Consensus 218 ~v~s~pg~~~~~svTal~F~--d~gL~~aVGts~G~v~iyDLRa~~pl~---~kdh~~e~pi~~l~~~~~~~q~~v~S~D 292 (703)
T KOG2321|consen 218 SVNSHPGGDAAPSVTALKFR--DDGLHVAVGTSTGSVLIYDLRASKPLL---VKDHGYELPIKKLDWQDTDQQNKVVSMD 292 (703)
T ss_pred ccCCCccccccCcceEEEec--CCceeEEeeccCCcEEEEEcccCCcee---ecccCCccceeeecccccCCCceEEecc
Confidence 11 1 113334322 236789999999999999987543211 1224555666554442223334445444
Q ss_pred CceE
Q 001655 597 RPTV 600 (1036)
Q Consensus 597 ~p~~ 600 (1036)
...+
T Consensus 293 k~~~ 296 (703)
T KOG2321|consen 293 KRIL 296 (703)
T ss_pred hHHh
Confidence 4433
No 76
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=93.33 E-value=2 Score=43.63 Aligned_cols=145 Identities=18% Similarity=0.298 Sum_probs=92.7
Q ss_pred CceEEEEEeeeeCCCCCCCcceEEEEEEEe---------CCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEeee
Q 001655 728 SNVYYCVGTAYVLPEENEPTKGRILVFIVE---------DGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWML 798 (1036)
Q Consensus 728 ~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~---------~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~~ 798 (1036)
.++|+++|.. -|.|-+++++ .+|++++.....+||+|.++..+..|+.|-...++=+.|.+
T Consensus 21 ~~~~l~agn~----------~G~iav~sl~sl~s~sa~~~gk~~iv~eqahdgpiy~~~f~d~~Lls~gdG~V~gw~W~E 90 (325)
T KOG0649|consen 21 SKQYLFAGNL----------FGDIAVLSLKSLDSGSAEPPGKLKIVPEQAHDGPIYYLAFHDDFLLSGGDGLVYGWEWNE 90 (325)
T ss_pred cceEEEEecC----------CCeEEEEEehhhhccccCCCCCcceeeccccCCCeeeeeeehhheeeccCceEEEeeehh
Confidence 3688888864 3788888888 46888999889999999999999999888778888888864
Q ss_pred cC--CCccchhc-cccccc-----c-eEEEEEEEeCC-EEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEee
Q 001655 799 RD--DGTRELQS-ECGHHG-----H-ILALYVQTRGD-FIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILD 868 (1036)
Q Consensus 799 ~~--~~~~~L~~-~~~~~~-----~-~~~~~l~~~~~-~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~ 868 (1036)
.. ++.|+|-. +..++. + +.++.++-..| .+++| -+++ ++.++-+++++...-|--.. .+ .+....
T Consensus 91 ~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~Ag--GD~~-~y~~dlE~G~i~r~~rGHtD-Yv-H~vv~R 165 (325)
T KOG0649|consen 91 EEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAG--GDGV-IYQVDLEDGRIQREYRGHTD-YV-HSVVGR 165 (325)
T ss_pred hhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEec--CCeE-EEEEEecCCEEEEEEcCCcc-ee-eeeeec
Confidence 32 23333322 111211 1 24566664444 55555 4444 57888888888766543211 11 122221
Q ss_pred C--ceEEEEccCCcEEEEeeC
Q 001655 869 D--DIYLGAENNFNLFTVRKN 887 (1036)
Q Consensus 869 ~--~~~l~~D~~gnl~~l~~~ 887 (1036)
+ ..++.+-.+|.+.+....
T Consensus 166 ~~~~qilsG~EDGtvRvWd~k 186 (325)
T KOG0649|consen 166 NANGQILSGAEDGTVRVWDTK 186 (325)
T ss_pred ccCcceeecCCCccEEEEecc
Confidence 2 347777778888887643
No 77
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=93.21 E-value=16 Score=40.47 Aligned_cols=193 Identities=15% Similarity=0.138 Sum_probs=101.5
Q ss_pred eCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEee
Q 001655 658 PLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTA 737 (1036)
Q Consensus 658 ~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~ 737 (1036)
+..+..+-+.-||....++-++.+ ++..|-|-.+...+....-+..+.- +.+..|.. .=++.||+
T Consensus 301 ~h~~~V~~ls~h~tgeYllsAs~d----------~~w~Fsd~~~g~~lt~vs~~~s~v~--~ts~~fHp---DgLifgtg 365 (506)
T KOG0289|consen 301 PHEEPVTGLSLHPTGEYLLSASND----------GTWAFSDISSGSQLTVVSDETSDVE--YTSAAFHP---DGLIFGTG 365 (506)
T ss_pred cccccceeeeeccCCcEEEEecCC----------ceEEEEEccCCcEEEEEeeccccce--eEEeeEcC---CceEEecc
Confidence 333444555556665544433322 4555666666666554443333321 22233432 22445554
Q ss_pred eeCCCCCCCcceEEEEEEEeCCeEEEEEEEE-ecCceeEeccc-cCe-EEEEECCE-EEEEEeeecCCCccchhcccc--
Q 001655 738 YVLPEENEPTKGRILVFIVEDGKLQLIAEKE-TKGAVYSLNAF-NGK-LLAAINQK-IQLYKWMLRDDGTRELQSECG-- 811 (1036)
Q Consensus 738 ~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~-~~g~v~~i~~~-~g~-Lv~~~g~~-l~v~~~~~~~~~~~~L~~~~~-- 811 (1036)
- ..|-+.+|+++... .+..+. ..|||.+|.-- ||| |+++.... |++|++. |+...-.
T Consensus 366 t--------~d~~vkiwdlks~~--~~a~Fpght~~vk~i~FsENGY~Lat~add~~V~lwDLR-------Kl~n~kt~~ 428 (506)
T KOG0289|consen 366 T--------PDGVVKIWDLKSQT--NVAKFPGHTGPVKAISFSENGYWLATAADDGSVKLWDLR-------KLKNFKTIQ 428 (506)
T ss_pred C--------CCceEEEEEcCCcc--ccccCCCCCCceeEEEeccCceEEEEEecCCeEEEEEeh-------hhcccceee
Confidence 2 55899999988654 334333 67899999855 675 66677765 8887652 2221111
Q ss_pred ccc--ceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcc-eeEEEEEeeCceEEEE-ccCCcEEEE
Q 001655 812 HHG--HILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNAN-WMSAVEILDDDIYLGA-ENNFNLFTV 884 (1036)
Q Consensus 812 ~~~--~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~-~~~~~~~l~~~~~l~~-D~~gnl~~l 884 (1036)
.+. ....++++-.|.++.++ -..+.++.|+....+..++..-.... ..+.+.|=+...++++ -.+.++.++
T Consensus 429 l~~~~~v~s~~fD~SGt~L~~~--g~~l~Vy~~~k~~k~W~~~~~~~~~sg~st~v~Fg~~aq~l~s~smd~~l~~~ 503 (506)
T KOG0289|consen 429 LDEKKEVNSLSFDQSGTYLGIA--GSDLQVYICKKKTKSWTEIKELADHSGLSTGVRFGEHAQYLASTSMDAILRLY 503 (506)
T ss_pred ccccccceeEEEcCCCCeEEee--cceeEEEEEecccccceeeehhhhcccccceeeecccceEEeeccchhheEEe
Confidence 111 13456666678888887 77888998886554443333221111 2345555444444443 234444433
No 78
>PTZ00420 coronin; Provisional
Probab=93.16 E-value=24 Score=42.25 Aligned_cols=214 Identities=14% Similarity=0.109 Sum_probs=104.4
Q ss_pred CccceEEEecC-CCEEEEEEeecCCCCCceeeEEEEEEeCCCce-EEE-----EEECCCCC-eEeEEEEEEEcCCCceEE
Q 001655 661 EHPRRICHQEQ-SRTFAICSLKNQSCAEESEMHFVRLLDDQTFE-FIS-----TYPLDTFE-YGCSILSCSFSDDSNVYY 732 (1036)
Q Consensus 661 ~tp~~i~y~~~-~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~-~i~-----~~~~~~~E-~v~si~~~~l~~~~~~~i 732 (1036)
..+..+.++|. .+.++.++.+ +.|++.|..+.. ... ...+..+. .+.+ +.+......++
T Consensus 75 ~~V~~lafsP~~~~lLASgS~D----------gtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~s---Vaf~P~g~~iL 141 (568)
T PTZ00420 75 SSILDLQFNPCFSEILASGSED----------LTIRVWEIPHNDESVKEIKDPQCILKGHKKKISI---IDWNPMNYYIM 141 (568)
T ss_pred CCEEEEEEcCCCCCEEEEEeCC----------CeEEEEECCCCCccccccccceEEeecCCCcEEE---EEECCCCCeEE
Confidence 45677888886 4555544432 478888764321 110 01222222 2333 33333333334
Q ss_pred EEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEE--CCEEEEEEeeecCCCccchhcc
Q 001655 733 CVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAI--NQKIQLYKWMLRDDGTRELQSE 809 (1036)
Q Consensus 733 ~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~--g~~l~v~~~~~~~~~~~~L~~~ 809 (1036)
+.|. .-|.|.+|++..++.. ......++|++++-- +|.++++. +++|++|+.. . + ..+...
T Consensus 142 aSgS----------~DgtIrIWDl~tg~~~--~~i~~~~~V~SlswspdG~lLat~s~D~~IrIwD~R--s-g-~~i~tl 205 (568)
T PTZ00420 142 CSSG----------FDSFVNIWDIENEKRA--FQINMPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPR--K-Q-EIASSF 205 (568)
T ss_pred EEEe----------CCCeEEEEECCCCcEE--EEEecCCcEEEEEECCCCCEEEEEecCCEEEEEECC--C-C-cEEEEE
Confidence 4443 2378999999866532 233456788888743 56666544 5689998753 1 1 111111
Q ss_pred cccccce--EEEEE---EEeCCEEEEEecc----ccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeC--c-eEEEEcc
Q 001655 810 CGHHGHI--LALYV---QTRGDFIVVGDLM----KSISLLIYKHEEGAIEERARDYNANWMSAVEILDD--D-IYLGAEN 877 (1036)
Q Consensus 810 ~~~~~~~--~~~~l---~~~~~~I~vgD~~----~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~--~-~~l~~D~ 877 (1036)
..+.... ..+.+ ...+++|+.+-.- +.+.++..+.....+..+.-|..+-.++. +.+. + .++++-.
T Consensus 206 ~gH~g~~~s~~v~~~~fs~d~~~IlTtG~d~~~~R~VkLWDlr~~~~pl~~~~ld~~~~~L~p--~~D~~tg~l~lsGkG 283 (568)
T PTZ00420 206 HIHDGGKNTKNIWIDGLGGDDNYILSTGFSKNNMREMKLWDLKNTTSALVTMSIDNASAPLIP--HYDESTGLIYLIGKG 283 (568)
T ss_pred ecccCCceeEEEEeeeEcCCCCEEEEEEcCCCCccEEEEEECCCCCCceEEEEecCCccceEE--eeeCCCCCEEEEEEC
Confidence 1122111 11121 1345677764433 34666544322333333333333322222 2232 2 3567778
Q ss_pred CCcEEEEeeCCCCCCcccccceeEEEEEEcCCccce
Q 001655 878 NFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNR 913 (1036)
Q Consensus 878 ~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~ 913 (1036)
++++.+|++..+ .+....+|+.++....
T Consensus 284 D~tIr~~e~~~~--------~~~~l~~~~s~~p~~g 311 (568)
T PTZ00420 284 DGNCRYYQHSLG--------SIRKVNEYKSCSPFRS 311 (568)
T ss_pred CCeEEEEEccCC--------cEEeecccccCCCccc
Confidence 999999998642 2334445554444433
No 79
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=93.05 E-value=3.4 Score=42.19 Aligned_cols=142 Identities=12% Similarity=0.089 Sum_probs=89.8
Q ss_pred CCeEEE-EecCcEEEEecCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEE
Q 001655 406 YNQLVQ-VTSGSVRLVSSTSRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISC 482 (1036)
Q Consensus 406 ~~~~vQ-Vt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~ 482 (1036)
+..|+- --...||+.|-.+++.++....+. .++.+.+. +.++.++. ++.+.+.+.+ .|..+++++++..|.+
T Consensus 155 D~~iLSSadd~tVRLWD~rTgt~v~sL~~~s--~VtSlEvs~dG~ilTia~-gssV~Fwdak--sf~~lKs~k~P~nV~S 229 (334)
T KOG0278|consen 155 DKCILSSADDKTVRLWDHRTGTEVQSLEFNS--PVTSLEVSQDGRILTIAY-GSSVKFWDAK--SFGLLKSYKMPCNVES 229 (334)
T ss_pred CceEEeeccCCceEEEEeccCcEEEEEecCC--CCcceeeccCCCEEEEec-CceeEEeccc--cccceeeccCcccccc
Confidence 566666 346789999988877787776543 56677654 55666665 6777776653 5667788888888887
Q ss_pred EEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecC
Q 001655 483 LDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMK 561 (1036)
Q Consensus 483 l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~ 561 (1036)
-++.| ...+++.|-. +..++-|+..+-+-+-...-....+.+++.+.+ +...--.|..||.+..++..+.
T Consensus 230 ASL~P------~k~~fVaGge-d~~~~kfDy~TgeEi~~~nkgh~gpVhcVrFSP--dGE~yAsGSEDGTirlWQt~~~ 299 (334)
T KOG0278|consen 230 ASLHP------KKEFFVAGGE-DFKVYKFDYNTGEEIGSYNKGHFGPVHCVRFSP--DGELYASGSEDGTIRLWQTTPG 299 (334)
T ss_pred ccccC------CCceEEecCc-ceEEEEEeccCCceeeecccCCCCceEEEEECC--CCceeeccCCCceEEEEEecCC
Confidence 77765 1345555544 667777776654332221111112445555443 2333456999999999987764
No 80
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=93.03 E-value=3.3 Score=43.70 Aligned_cols=134 Identities=12% Similarity=0.191 Sum_probs=82.5
Q ss_pred CeEEEEEeCC--CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC------CCceEEEEEE-----CCCCCeEe
Q 001655 651 KLHIRSIPLG--EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD------QTFEFISTYP-----LDTFEYGC 717 (1036)
Q Consensus 651 ~~~~~~i~l~--~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~------~t~~~i~~~~-----~~~~E~v~ 717 (1036)
.|.-++.-.+ ....-|.|-|...-+-+++... -+.||+++. ..|.....+. ...++...
T Consensus 101 ~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~a--------DG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~~ 172 (361)
T KOG2445|consen 101 RWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASA--------DGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQPC 172 (361)
T ss_pred eeEEEEEeecCCcceeEEEecchhcceEEEEecc--------CcEEEEEecCCccccccchhhhhhhhccCCcccccCcc
Confidence 4554444332 3455666766444333333221 157777753 3344333222 23566667
Q ss_pred EEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC--eEEEEEEE-EecCceeEeccc--cC--e--EEEEEC
Q 001655 718 SILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG--KLQLIAEK-ETKGAVYSLNAF--NG--K--LLAAIN 788 (1036)
Q Consensus 718 si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~--kl~~~~~~-~~~g~v~~i~~~--~g--~--Lv~~~g 788 (1036)
.+.+|.......++|+||. +|+.+..++.++|+..++ |...+.+. ....||++|+-- -| + |.+|.+
T Consensus 173 ~CvsWn~sr~~~p~iAvgs-----~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~Gr~y~~lAvA~k 247 (361)
T KOG2445|consen 173 FCVSWNPSRMHEPLIAVGS-----DEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNIGRSYHLLAVATK 247 (361)
T ss_pred eEEeeccccccCceEEEEc-----ccCCccccceEEEEecCCcceeeeehhcCCCCCcceeeeeccccCCceeeEEEeec
Confidence 7778876556689999998 567789999999999843 66555543 567899998733 23 2 455666
Q ss_pred CEEEEEEee
Q 001655 789 QKIQLYKWM 797 (1036)
Q Consensus 789 ~~l~v~~~~ 797 (1036)
.-|++|.+.
T Consensus 248 Dgv~I~~v~ 256 (361)
T KOG2445|consen 248 DGVRIFKVK 256 (361)
T ss_pred CcEEEEEEe
Confidence 669999874
No 81
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=92.90 E-value=21 Score=40.94 Aligned_cols=127 Identities=14% Similarity=0.180 Sum_probs=73.1
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCce-eEEEEcCCCCCCC
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYE-ISCLDINPIGENP 492 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~-is~l~~~~~~~~~ 492 (1036)
...+..++..+++ ..|..+.+.. ......++.+.+...++.++.++..+++..=... .+... .+...+
T Consensus 265 ~g~l~ald~~tG~--~~W~~~~~~~-~~~~~~~~~vy~~~~~g~l~ald~~tG~~~W~~~-~~~~~~~~sp~v------- 333 (394)
T PRK11138 265 NGNLVALDLRSGQ--IVWKREYGSV-NDFAVDGGRIYLVDQNDRVYALDTRGGVELWSQS-DLLHRLLTAPVL------- 333 (394)
T ss_pred CCeEEEEECCCCC--EEEeecCCCc-cCcEEECCEEEEEcCCCeEEEEECCCCcEEEccc-ccCCCcccCCEE-------
Confidence 3456667766543 3476543321 1223456667777677888888776654321111 11111 111111
Q ss_pred CcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 493 SYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 493 ~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
....+.++.- +|.+..++..+.+++++..+.......+..+. ...|++++.||.|+.++
T Consensus 334 -~~g~l~v~~~-~G~l~~ld~~tG~~~~~~~~~~~~~~s~P~~~----~~~l~v~t~~G~l~~~~ 392 (394)
T PRK11138 334 -YNGYLVVGDS-EGYLHWINREDGRFVAQQKVDSSGFLSEPVVA----DDKLLIQARDGTVYAIT 392 (394)
T ss_pred -ECCEEEEEeC-CCEEEEEECCCCCEEEEEEcCCCcceeCCEEE----CCEEEEEeCCceEEEEe
Confidence 1456777766 89999999888888887666422222222222 34799999999998865
No 82
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=92.80 E-value=7 Score=42.85 Aligned_cols=64 Identities=11% Similarity=0.118 Sum_probs=44.9
Q ss_pred EEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCc
Q 001655 497 IAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGE 564 (1036)
Q Consensus 497 ~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~ 564 (1036)
.+.++.- ++.|.|++++.-..+...... ..+-|.+.. ..+..++++|+.+|.+++|.+...++.
T Consensus 208 Ll~~asl-~nkiki~dlet~~~vssy~a~--~~~wSC~wD-lde~h~IYaGl~nG~VlvyD~R~~~~~ 271 (463)
T KOG1645|consen 208 LLGLASL-GNKIKIMDLETSCVVSSYIAY--NQIWSCCWD-LDERHVIYAGLQNGMVLVYDMRQPEGP 271 (463)
T ss_pred eeeeecc-CceEEEEecccceeeeheecc--CCceeeeec-cCCcceeEEeccCceEEEEEccCCCch
Confidence 4556655 889999999875555444333 345566543 345889999999999999998765443
No 83
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=92.75 E-value=13 Score=37.97 Aligned_cols=154 Identities=15% Similarity=0.143 Sum_probs=86.0
Q ss_pred eeeeecCeeccccceeeeecCCCeEEEEecCcEEEEecCC--ccceeeeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEE
Q 001655 385 EETEIEGFCSQTQTLFCHDAIYNQLVQVTSGSVRLVSSTS--RELRNEWKSPPGYSVNVATANASQVLLATGGGHLVYLE 462 (1036)
Q Consensus 385 ~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt~~~i~l~~~~~--~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~ 462 (1036)
-+++.-.|..+..-++.|.+ ..++|+.+-.+ .+.++-... .-..|....+++.-++-..-+|.+.-+.
T Consensus 102 aqVNtV~fNeesSVv~Sgsf---------D~s~r~wDCRS~s~ePiQilde-a~D~V~Si~v~~heIvaGS~DGtvRtyd 171 (307)
T KOG0316|consen 102 AQVNTVRFNEESSVVASGSF---------DSSVRLWDCRSRSFEPIQILDE-AKDGVSSIDVAEHEIVAGSVDGTVRTYD 171 (307)
T ss_pred ceeeEEEecCcceEEEeccc---------cceeEEEEcccCCCCccchhhh-hcCceeEEEecccEEEeeccCCcEEEEE
Confidence 34444556555555666655 34556665432 112221111 1123555555555555444466776667
Q ss_pred EcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeE--EecCCCccCceeEEeeeecC
Q 001655 463 IGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLIT--KEHLGGEIIPRSVLLCAFEG 540 (1036)
Q Consensus 463 ~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~--~~~l~~~~~p~si~~~~~~~ 540 (1036)
+..|++ .+--+...|+|+++++ .++..+++.- ++++++++-.+.+++. +.+...+...++ ++ .++
T Consensus 172 iR~G~l---~sDy~g~pit~vs~s~------d~nc~La~~l-~stlrLlDk~tGklL~sYkGhkn~eykldc-~l--~qs 238 (307)
T KOG0316|consen 172 IRKGTL---SSDYFGHPITSVSFSK------DGNCSLASSL-DSTLRLLDKETGKLLKSYKGHKNMEYKLDC-CL--NQS 238 (307)
T ss_pred eeccee---ehhhcCCcceeEEecC------CCCEEEEeec-cceeeecccchhHHHHHhcccccceeeeee-ee--ccc
Confidence 755543 2234677899999864 3678888877 9999998866544432 111111111111 11 134
Q ss_pred eEEEEEEeCCCcEEEEEEecC
Q 001655 541 ISYLLCALGDGHLLNFLLNMK 561 (1036)
Q Consensus 541 ~~~L~vgl~~G~l~~y~~~~~ 561 (1036)
..+++-|..||.++.|.+...
T Consensus 239 dthV~sgSEDG~Vy~wdLvd~ 259 (307)
T KOG0316|consen 239 DTHVFSGSEDGKVYFWDLVDE 259 (307)
T ss_pred ceeEEeccCCceEEEEEeccc
Confidence 678999999999999887643
No 84
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=92.69 E-value=19 Score=39.94 Aligned_cols=144 Identities=16% Similarity=0.169 Sum_probs=85.8
Q ss_pred CCCCeEEEEeCCe-EEEEEEcCCCCeEEEEEe-CCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEE
Q 001655 628 AFPDSLAIAKEGE-LTIGTIDDIQKLHIRSIP-LGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 628 ~~~~~l~~~~~~~-l~i~~l~~~~~~~~~~i~-l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i 705 (1036)
..++.|+.+++++ .-+..+.....+..-+-. -+-..+..++||+...|+..+.. +.|+++|-++...+
T Consensus 313 ~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs~~~s~v~~ts~~fHpDgLifgtgt~d----------~~vkiwdlks~~~~ 382 (506)
T KOG0289|consen 313 PTGEYLLSASNDGTWAFSDISSGSQLTVVSDETSDVEYTSAAFHPDGLIFGTGTPD----------GVVKIWDLKSQTNV 382 (506)
T ss_pred cCCcEEEEecCCceEEEEEccCCcEEEEEeeccccceeEEeeEcCCceEEeccCCC----------ceEEEEEcCCcccc
Confidence 3456777776544 444444444333332222 12245678899998888877654 68999998776644
Q ss_pred EEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCe-EEEEEEEEecCceeEeccc-cCeE
Q 001655 706 STYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGK-LQLIAEKETKGAVYSLNAF-NGKL 783 (1036)
Q Consensus 706 ~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~k-l~~~~~~~~~g~v~~i~~~-~g~L 783 (1036)
. .|+.++.. +..+.|.. +.-|+++++ ..|.+.+|++.+.+ ++.+...+ +.+|-+++-- .|.+
T Consensus 383 a--~Fpght~~--vk~i~FsE-NGY~Lat~a----------dd~~V~lwDLRKl~n~kt~~l~~-~~~v~s~~fD~SGt~ 446 (506)
T KOG0289|consen 383 A--KFPGHTGP--VKAISFSE-NGYWLATAA----------DDGSVKLWDLRKLKNFKTIQLDE-KKEVNSLSFDQSGTY 446 (506)
T ss_pred c--cCCCCCCc--eeEEEecc-CceEEEEEe----------cCCeEEEEEehhhcccceeeccc-cccceeEEEcCCCCe
Confidence 4 56665543 45667753 455677666 23568999987533 22222222 2245555522 4555
Q ss_pred EEEECCEEEEEEee
Q 001655 784 LAAINQKIQLYKWM 797 (1036)
Q Consensus 784 v~~~g~~l~v~~~~ 797 (1036)
+++.|+.+++|.+.
T Consensus 447 L~~~g~~l~Vy~~~ 460 (506)
T KOG0289|consen 447 LGIAGSDLQVYICK 460 (506)
T ss_pred EEeecceeEEEEEe
Confidence 55559999999874
No 85
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=92.29 E-value=9 Score=42.79 Aligned_cols=204 Identities=15% Similarity=0.187 Sum_probs=111.9
Q ss_pred EEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEE
Q 001655 655 RSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCV 734 (1036)
Q Consensus 655 ~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~V 734 (1036)
+++-+.+-.+.++-.|. ..|+++... ...|.+..-.|++.+..+ ......++|+. |.+ +..+|+-
T Consensus 76 q~~v~Pg~v~al~s~n~-G~~l~ag~i---------~g~lYlWelssG~LL~v~-~aHYQ~ITcL~---fs~-dgs~iiT 140 (476)
T KOG0646|consen 76 QYIVLPGPVHALASSNL-GYFLLAGTI---------SGNLYLWELSSGILLNVL-SAHYQSITCLK---FSD-DGSHIIT 140 (476)
T ss_pred hhcccccceeeeecCCC-ceEEEeecc---------cCcEEEEEeccccHHHHH-HhhccceeEEE---EeC-CCcEEEe
Confidence 55556666666665544 456666532 135666666666655433 33445566654 443 4566665
Q ss_pred EeeeeCCCCCCCcceEEEEEEEe-------CCeEEEEEEE-EecCceeEecc----ccCeEE-EEECCEEEEEEeeecCC
Q 001655 735 GTAYVLPEENEPTKGRILVFIVE-------DGKLQLIAEK-ETKGAVYSLNA----FNGKLL-AAINQKIQLYKWMLRDD 801 (1036)
Q Consensus 735 GT~~~~~~e~~~~~Gri~v~~i~-------~~kl~~~~~~-~~~g~v~~i~~----~~g~Lv-~~~g~~l~v~~~~~~~~ 801 (1036)
|. .-|++++|.+. ++..+.++.. ++.=||+.+.. .+.+|+ ++..+++++|++..
T Consensus 141 gs----------kDg~V~vW~l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~--- 207 (476)
T KOG0646|consen 141 GS----------KDGAVLVWLLTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSL--- 207 (476)
T ss_pred cC----------CCccEEEEEEEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEecc---
Confidence 53 45889999877 2233444433 23446665542 244666 45668889988741
Q ss_pred CccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccC---CeEEEEecc------------CCcceeEEEEE
Q 001655 802 GTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEE---GAIEERARD------------YNANWMSAVEI 866 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~---~~l~~~a~D------------~~~~~~~~~~~ 866 (1036)
| .|+....++....++.++-.+..+++|..--.+++..+-.-+ .-+..-+++ .....+++...
T Consensus 208 g--~LLlti~fp~si~av~lDpae~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLai 285 (476)
T KOG0646|consen 208 G--VLLLTITFPSSIKAVALDPAERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAI 285 (476)
T ss_pred c--eeeEEEecCCcceeEEEcccccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEE
Confidence 2 344333333334455556667789999988888766543211 100011111 11123444443
Q ss_pred eeCce-EEEEccCCcEEEEeeCC
Q 001655 867 LDDDI-YLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 867 l~~~~-~l~~D~~gnl~~l~~~~ 888 (1036)
=-+++ .+.+|.+|++.+.+...
T Consensus 286 s~DgtlLlSGd~dg~VcvWdi~S 308 (476)
T KOG0646|consen 286 STDGTLLLSGDEDGKVCVWDIYS 308 (476)
T ss_pred ecCccEEEeeCCCCCEEEEecch
Confidence 33444 67899999999988653
No 86
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=92.06 E-value=17 Score=37.89 Aligned_cols=256 Identities=15% Similarity=0.181 Sum_probs=141.0
Q ss_pred CCeEEEEEEcCCCCeEEEEEeC---CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEe--CCCceEEEEEECCC
Q 001655 638 EGELTIGTIDDIQKLHIRSIPL---GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLD--DQTFEFISTYPLDT 712 (1036)
Q Consensus 638 ~~~l~i~~l~~~~~~~~~~i~l---~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d--~~t~~~i~~~~~~~ 712 (1036)
+..++|-.......|..|.+-- .++.|++++.|..+.++.++.+ +++.+.. ...|+.++.+|=.+
T Consensus 36 Dk~vriw~~~~~~s~~ck~vld~~hkrsVRsvAwsp~g~~La~aSFD----------~t~~Iw~k~~~efecv~~lEGHE 105 (312)
T KOG0645|consen 36 DKAVRIWSTSSGDSWTCKTVLDDGHKRSVRSVAWSPHGRYLASASFD----------ATVVIWKKEDGEFECVATLEGHE 105 (312)
T ss_pred CceEEEEecCCCCcEEEEEeccccchheeeeeeecCCCcEEEEeecc----------ceEEEeecCCCceeEEeeeeccc
Confidence 5677777777555677776653 3689999999999977777664 2344443 25688888888777
Q ss_pred CCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe-CCeEEEEEE-----EEecCceeEeccccCeEE-E
Q 001655 713 FEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE-DGKLQLIAE-----KETKGAVYSLNAFNGKLL-A 785 (1036)
Q Consensus 713 ~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~-~~kl~~~~~-----~~~~g~v~~i~~~~g~Lv-~ 785 (1036)
+|. +.+.+. ....|++.++- --.+.++++. +..++.+.. .++++.+ -.+-.+-|+ +
T Consensus 106 nEV----K~Vaws-~sG~~LATCSR----------DKSVWiWe~deddEfec~aVL~~HtqDVK~V~--WHPt~dlL~S~ 168 (312)
T KOG0645|consen 106 NEV----KCVAWS-ASGNYLATCSR----------DKSVWIWEIDEDDEFECIAVLQEHTQDVKHVI--WHPTEDLLFSC 168 (312)
T ss_pred cce----eEEEEc-CCCCEEEEeeC----------CCeEEEEEecCCCcEEEEeeeccccccccEEE--EcCCcceeEEe
Confidence 775 333343 24678886652 1267888888 334543332 2233221 112234444 3
Q ss_pred EECCEEEEEEeeecCCCccchhcccccccc---eEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeE
Q 001655 786 AINQKIQLYKWMLRDDGTRELQSECGHHGH---ILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMS 862 (1036)
Q Consensus 786 ~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~---~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~ 862 (1036)
+..++|++|+-. +++++++.. .++.+ ...+...-.|++++.++--.-+.+.++... + ...+.+.+.
T Consensus 169 SYDnTIk~~~~~--~dddW~c~~--tl~g~~~TVW~~~F~~~G~rl~s~sdD~tv~Iw~~~~~------~-~~~~sr~~Y 237 (312)
T KOG0645|consen 169 SYDNTIKVYRDE--DDDDWECVQ--TLDGHENTVWSLAFDNIGSRLVSCSDDGTVSIWRLYTD------L-SGMHSRALY 237 (312)
T ss_pred ccCCeEEEEeec--CCCCeeEEE--EecCccceEEEEEecCCCceEEEecCCcceEeeeeccC------c-chhcccceE
Confidence 445899998843 234555543 22333 233334445678777776666766653211 0 122333333
Q ss_pred EEEEeeCceEEEEccCCcEEEEeeCCCCCCccccccee-EEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEcccc
Q 001655 863 AVEILDDDIYLGAENNFNLFTVRKNSEGATDEERGRLE-VVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNG 941 (1036)
Q Consensus 863 ~~~~l~~~~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~-~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~G 941 (1036)
.+-- .++.+..+-.++-|.+|+........ ..++. .....| +..||++.-. +.....++.|+-||
T Consensus 238 ~v~W-~~~~IaS~ggD~~i~lf~~s~~~d~p--~~~l~~~~~~aH-e~dVNsV~w~----------p~~~~~L~s~~DDG 303 (312)
T KOG0645|consen 238 DVPW-DNGVIASGGGDDAIRLFKESDSPDEP--SWNLLAKKEGAH-EVDVNSVQWN----------PKVSNRLASGGDDG 303 (312)
T ss_pred eeee-cccceEeccCCCEEEEEEecCCCCCc--hHHHHHhhhccc-ccccceEEEc----------CCCCCceeecCCCc
Confidence 3322 24566666678888888876321111 11221 122222 3467765421 12345777788888
Q ss_pred ceEE
Q 001655 942 VIGV 945 (1036)
Q Consensus 942 sIg~ 945 (1036)
.+-.
T Consensus 304 ~v~~ 307 (312)
T KOG0645|consen 304 IVNF 307 (312)
T ss_pred eEEE
Confidence 7654
No 87
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=91.62 E-value=17 Score=37.51 Aligned_cols=66 Identities=17% Similarity=0.257 Sum_probs=53.3
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEe-CCeEEEEEEEEecCceeEeccc---cCeEEEEEC-CEEEEEEee
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVE-DGKLQLIAEKETKGAVYSLNAF---NGKLLAAIN-QKIQLYKWM 797 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~-~~kl~~~~~~~~~g~v~~i~~~---~g~Lv~~~g-~~l~v~~~~ 797 (1036)
.++++|.|+..+ .....|||+++++. .+.+.++.+.+....++.++=- .+.+++|+| ..+++|+..
T Consensus 21 ~nrLavAt~q~y---Gl~G~G~L~ile~~~~~gi~e~~s~d~~D~LfdV~Wse~~e~~~~~a~GDGSLrl~d~~ 91 (311)
T KOG0277|consen 21 ENRLAVATAQHY---GLAGNGRLFILEVTDPKGIQECQSYDTEDGLFDVAWSENHENQVIAASGDGSLRLFDLT 91 (311)
T ss_pred cchhheeehhhc---ccccCceEEEEecCCCCCeEEEEeeecccceeEeeecCCCcceEEEEecCceEEEeccC
Confidence 467899998877 35688999999996 5679999999999999988733 346778888 689998853
No 88
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=91.40 E-value=18 Score=41.86 Aligned_cols=184 Identities=15% Similarity=0.219 Sum_probs=100.4
Q ss_pred eCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCc---------eEEEE
Q 001655 637 KEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTF---------EFIST 707 (1036)
Q Consensus 637 ~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~---------~~i~~ 707 (1036)
+++.++|-.+-+. -.++++.+++..++|++.|..+.-+++..-. .++.++++.=+ +.+.+
T Consensus 420 dDGtvriWEi~Tg--Rcvr~~~~d~~I~~vaw~P~~~~~vLAvA~~---------~~~~ivnp~~G~~~e~~~t~ell~~ 488 (733)
T KOG0650|consen 420 DDGTVRIWEIATG--RCVRTVQFDSEIRSVAWNPLSDLCVLAVAVG---------ECVLIVNPIFGDRLEVGPTKELLAS 488 (733)
T ss_pred CCCcEEEEEeecc--eEEEEEeecceeEEEEecCCCCceeEEEEec---------CceEEeCccccchhhhcchhhhhhc
Confidence 3577777777653 4578999999999999998777555544321 12344444221 11111
Q ss_pred E----------------ECCCCCeEeEEEEEEEcC-------CCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEE
Q 001655 708 Y----------------PLDTFEYGCSILSCSFSD-------DSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLI 764 (1036)
Q Consensus 708 ~----------------~~~~~E~v~si~~~~l~~-------~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~ 764 (1036)
. ..++.|.-.|+.....+. ....||++-..- ...-++++.++.+++-+ .
T Consensus 489 ~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~vtWHrkGDYlatV~~~-------~~~~~VliHQLSK~~sQ-~ 560 (733)
T KOG0650|consen 489 APNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQVTWHRKGDYLATVMPD-------SGNKSVLIHQLSKRKSQ-S 560 (733)
T ss_pred CCCccCCcccceeechhhhhhhccceEEEEecCCccceeeeecCCceEEEeccC-------CCcceEEEEeccccccc-C
Confidence 1 111222222322222211 123555543321 12336777777654433 2
Q ss_pred EEEEecCceeEec--cccCeEEEEECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEE
Q 001655 765 AEKETKGAVYSLN--AFNGKLLAAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 765 ~~~~~~g~v~~i~--~~~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~ 842 (1036)
.-..-+|-|.++. +...+|++|.-..|++|++.-+ .-.++|...|.+. ..+++...|+-+++|..-+-+..+-.
T Consensus 561 PF~kskG~vq~v~FHPs~p~lfVaTq~~vRiYdL~kq-elvKkL~tg~kwi---S~msihp~GDnli~gs~d~k~~WfDl 636 (733)
T KOG0650|consen 561 PFRKSKGLVQRVKFHPSKPYLFVATQRSVRIYDLSKQ-ELVKKLLTGSKWI---SSMSIHPNGDNLILGSYDKKMCWFDL 636 (733)
T ss_pred chhhcCCceeEEEecCCCceEEEEeccceEEEehhHH-HHHHHHhcCCeee---eeeeecCCCCeEEEecCCCeeEEEEc
Confidence 2224567777765 3366899999999999998422 1224444444332 23455566788888887777655443
Q ss_pred e
Q 001655 843 K 843 (1036)
Q Consensus 843 ~ 843 (1036)
+
T Consensus 637 d 637 (733)
T KOG0650|consen 637 D 637 (733)
T ss_pred c
Confidence 3
No 89
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=91.31 E-value=12 Score=42.87 Aligned_cols=207 Identities=15% Similarity=0.178 Sum_probs=114.0
Q ss_pred CeEEEE-EEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEe---eecc
Q 001655 540 GISYLL-CALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYS---NVNL 615 (1036)
Q Consensus 540 ~~~~L~-vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~---~~~~ 615 (1036)
+..|++ .|+--=.+-+|.+... +|+. .+.+-..+|.+.++..+-...||...+|..=+....|+ .|. |-..
T Consensus 62 DGqY~lAtG~YKP~ikvydlanL--SLKF--ERhlDae~V~feiLsDD~SK~v~L~~DR~IefHak~G~-hy~~RIP~~G 136 (703)
T KOG2321|consen 62 DGQYLLATGTYKPQIKVYDLANL--SLKF--ERHLDAEVVDFEILSDDYSKSVFLQNDRTIEFHAKYGR-HYRTRIPKFG 136 (703)
T ss_pred CCcEEEEecccCCceEEEEcccc--eeee--eecccccceeEEEeccchhhheEeecCceeeehhhcCe-eeeeecCcCC
Confidence 345554 4666667778887642 2333 34567778888888544456788888876544433232 211 1111
Q ss_pred ccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEE
Q 001655 616 KEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFV 694 (1036)
Q Consensus 616 ~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l 694 (1036)
.++ .++.+.|. .++..++.. +.+++-.+.-..+.+.+. .....+--.+...++++++.. +.+
T Consensus 137 RDm----~y~~~scD-ly~~gsg~e--vYRlNLEqGrfL~P~~~~~~~lN~v~in~~hgLla~Gt~~----------g~V 199 (703)
T KOG2321|consen 137 RDM----KYHKPSCD-LYLVGSGSE--VYRLNLEQGRFLNPFETDSGELNVVSINEEHGLLACGTED----------GVV 199 (703)
T ss_pred ccc----cccCCCcc-EEEeecCcc--eEEEEccccccccccccccccceeeeecCccceEEecccC----------ceE
Confidence 111 13333332 233334444 445444333222223332 222334445555666665532 689
Q ss_pred EEEeCCCceEEEEEECCCC-------CeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEE
Q 001655 695 RLLDDQTFEFISTYPLDTF-------EYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEK 767 (1036)
Q Consensus 695 ~l~d~~t~~~i~~~~~~~~-------E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~ 767 (1036)
+++||.+...+.+++...+ ...-++..+.|.++ .=.++||| +.|.+|+|++.-.+--++..+
T Consensus 200 EfwDpR~ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d~-gL~~aVGt----------s~G~v~iyDLRa~~pl~~kdh 268 (703)
T KOG2321|consen 200 EFWDPRDKSRVGTLDAASSVNSHPGGDAAPSVTALKFRDD-GLHVAVGT----------STGSVLIYDLRASKPLLVKDH 268 (703)
T ss_pred EEecchhhhhheeeecccccCCCccccccCcceEEEecCC-ceeEEeec----------cCCcEEEEEcccCCceeeccc
Confidence 9999987776666554433 11223555667653 45689998 569999999986665556656
Q ss_pred EecCceeEeccc
Q 001655 768 ETKGAVYSLNAF 779 (1036)
Q Consensus 768 ~~~g~v~~i~~~ 779 (1036)
...-|+-.+.-.
T Consensus 269 ~~e~pi~~l~~~ 280 (703)
T KOG2321|consen 269 GYELPIKKLDWQ 280 (703)
T ss_pred CCccceeeeccc
Confidence 666666666543
No 90
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=91.28 E-value=18 Score=41.04 Aligned_cols=240 Identities=16% Similarity=0.201 Sum_probs=122.7
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE-----EE--C--CCCCeE--eEEEEEEEcCCCceE
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST-----YP--L--DTFEYG--CSILSCSFSDDSNVY 731 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~-----~~--~--~~~E~v--~si~~~~l~~~~~~~ 731 (1036)
.+.+.|++..+.++|++.. +..+++|-..++..-. |. + -.+..+ +|. .|. ..+++-
T Consensus 217 i~sl~ys~Tg~~iLvvsg~----------aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g-~wh--P~~k~~ 283 (641)
T KOG0772|consen 217 INSLQYSVTGDQILVVSGS----------AQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCG-CWH--PDNKEE 283 (641)
T ss_pred cceeeecCCCCeEEEEecC----------cceeEEccCCceeeeeeccchhhhhhhccCCceeeeecc-ccc--cCcccc
Confidence 4567799999999888765 3578888766655422 11 1 111111 111 121 111222
Q ss_pred EEEEeeeeCCCCCCCcceEEEEEEEeCCe--EEEEEEEEecC---ceeEeccc--cCeEE-EEE-CCEEEEEEeeecCCC
Q 001655 732 YCVGTAYVLPEENEPTKGRILVFIVEDGK--LQLIAEKETKG---AVYSLNAF--NGKLL-AAI-NQKIQLYKWMLRDDG 802 (1036)
Q Consensus 732 i~VGT~~~~~~e~~~~~Gri~v~~i~~~k--l~~~~~~~~~g---~v~~i~~~--~g~Lv-~~~-g~~l~v~~~~~~~~~ 802 (1036)
++ -+ ..-|.+.+|++.+.| ++++..+...| +|++++ | +|.++ +|+ ...|.+|+. +
T Consensus 284 Fl-T~---------s~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~-~nrdg~~iAagc~DGSIQ~W~~-----~ 347 (641)
T KOG0772|consen 284 FL-TC---------SYDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCA-WNRDGKLIAAGCLDGSIQIWDK-----G 347 (641)
T ss_pred eE-Ee---------cCCCcEEEEecCCchhheeEEeeccCCCcccCceeee-cCCCcchhhhcccCCceeeeec-----C
Confidence 22 11 134888999998643 55555444433 565544 5 45554 333 467877653 1
Q ss_pred ccch-----hccccccc-ceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEE--
Q 001655 803 TREL-----QSECGHHG-HILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLG-- 874 (1036)
Q Consensus 803 ~~~L-----~~~~~~~~-~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~-- 874 (1036)
.+-. .+.|-... -+..++.+..||+++-=-.-.++.++..+.-...|.....=+.+...+.|+|-.++.+|+
T Consensus 348 ~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~TG 427 (641)
T KOG0772|consen 348 SRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILTG 427 (641)
T ss_pred CcccccceEeeeccCCCCceeEEEeccccchhhhccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEec
Confidence 1111 12221111 122344455677776655555666554433222232222223444566777776665443
Q ss_pred -----EccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEec
Q 001655 875 -----AENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASL 949 (1036)
Q Consensus 875 -----~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l 949 (1036)
.+..|+|++|.. ..|+.+..+.+. -.+..+. .|. ..-++|+.|+.+|.+.++..=
T Consensus 428 tS~~~~~~~g~L~f~d~----------~t~d~v~ki~i~--~aSvv~~----~Wh----pkLNQi~~gsgdG~~~vyYdp 487 (641)
T KOG0772|consen 428 TSAPNGMTAGTLFFFDR----------MTLDTVYKIDIS--TASVVRC----LWH----PKLNQIFAGSGDGTAHVYYDP 487 (641)
T ss_pred ccccCCCCCceEEEEec----------cceeeEEEecCC--CceEEEE----eec----chhhheeeecCCCceEEEECc
Confidence 345678888864 245555544443 1112121 121 134689999999999887665
Q ss_pred Ch
Q 001655 950 PH 951 (1036)
Q Consensus 950 ~~ 951 (1036)
++
T Consensus 488 ~~ 489 (641)
T KOG0772|consen 488 NE 489 (641)
T ss_pred cc
Confidence 44
No 91
>PF02239 Cytochrom_D1: Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=91.27 E-value=31 Score=39.18 Aligned_cols=200 Identities=17% Similarity=0.191 Sum_probs=106.5
Q ss_pred ccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecC
Q 001655 495 SQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLG 574 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG 574 (1036)
.++++|....+|++.+++..+.+.+........ .+.++.+. .+..++++..+||.+..+.+ .+++ -.+++..|
T Consensus 5 ~~l~~V~~~~~~~v~viD~~t~~~~~~i~~~~~-~h~~~~~s--~Dgr~~yv~~rdg~vsviD~--~~~~--~v~~i~~G 77 (369)
T PF02239_consen 5 GNLFYVVERGSGSVAVIDGATNKVVARIPTGGA-PHAGLKFS--PDGRYLYVANRDGTVSVIDL--ATGK--VVATIKVG 77 (369)
T ss_dssp GGEEEEEEGGGTEEEEEETTT-SEEEEEE-STT-EEEEEE-T--T-SSEEEEEETTSEEEEEET--TSSS--EEEEEE-S
T ss_pred ccEEEEEecCCCEEEEEECCCCeEEEEEcCCCC-ceeEEEec--CCCCEEEEEcCCCeEEEEEC--Cccc--EEEEEecC
Confidence 567777777689999999988887765433321 22233222 23457888889997765544 3322 34567788
Q ss_pred ccceEEEEEEeCCceEEEEEcCC-ceEEEecCCcE---EEeeeccccc----eeeecccCCCCCCeEEEEe--CCeEEEE
Q 001655 575 TQPITLRTFSSKNTTHVFAASDR-PTVIYSSNKKL---LYSNVNLKEV----SHMCPFNSAAFPDSLAIAK--EGELTIG 644 (1036)
Q Consensus 575 ~~pv~l~~~~~~~~~~v~~~~~~-p~~i~~~~~~~---~~~~~~~~~i----~~~~~f~~~~~~~~l~~~~--~~~l~i~ 644 (1036)
..|..+.- ..++..+++.+.. +.+...+...+ ...|....+. ..++.+-.......+++.- .+++.+-
T Consensus 78 ~~~~~i~~--s~DG~~~~v~n~~~~~v~v~D~~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~lkd~~~I~vV 155 (369)
T PF02239_consen 78 GNPRGIAV--SPDGKYVYVANYEPGTVSVIDAETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVNLKDTGEIWVV 155 (369)
T ss_dssp SEEEEEEE----TTTEEEEEEEETTEEEEEETTT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEEETTTTEEEEE
T ss_pred CCcceEEE--cCCCCEEEEEecCCCceeEeccccccceeecccccccccccCCCceeEEecCCCCEEEEEEccCCeEEEE
Confidence 87755432 2344566666533 33333332222 2222211000 0111111111223355443 3555555
Q ss_pred EEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCC
Q 001655 645 TIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDT 712 (1036)
Q Consensus 645 ~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~ 712 (1036)
.......+..+.++.+..|+-..+.|+.+.|.++.... ..+-++|.++.+.+...+...
T Consensus 156 dy~d~~~~~~~~i~~g~~~~D~~~dpdgry~~va~~~s---------n~i~viD~~~~k~v~~i~~g~ 214 (369)
T PF02239_consen 156 DYSDPKNLKVTTIKVGRFPHDGGFDPDGRYFLVAANGS---------NKIAVIDTKTGKLVALIDTGK 214 (369)
T ss_dssp ETTTSSCEEEEEEE--TTEEEEEE-TTSSEEEEEEGGG---------TEEEEEETTTTEEEEEEE-SS
T ss_pred EeccccccceeeecccccccccccCcccceeeeccccc---------ceeEEEeeccceEEEEeeccc
Confidence 44445567889999999999999999988887765432 267788888877665555433
No 92
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=91.15 E-value=7.7 Score=40.93 Aligned_cols=211 Identities=15% Similarity=0.213 Sum_probs=107.8
Q ss_pred cCCeEEEEEEcCcEEEE-EEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCcee
Q 001655 454 GGGHLVYLEIGDGILTE-VKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRS 532 (1036)
Q Consensus 454 ~~~~~~~l~~~~~~l~~-~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~s 532 (1036)
.++.+.+|++..-.... .+-++-...+-|+++.| .+++++||+. -..+++|++...+--.... +.+..-.+
T Consensus 192 rD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHP------sGefllvgTd-Hp~~rlYdv~T~Qcfvsan-Pd~qht~a 263 (430)
T KOG0640|consen 192 RDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHP------SGEFLLVGTD-HPTLRLYDVNTYQCFVSAN-PDDQHTGA 263 (430)
T ss_pred CCCeEEEEecccHHHHHHHHHhhccceeeeEeecC------CCceEEEecC-CCceeEEeccceeEeeecC-cccccccc
Confidence 46778888765311000 00111224567888866 3789999998 8899999998755422211 22211223
Q ss_pred EEeeeecCeEEEEE-EeCCCcEEEEEEecCCCccccceeee----cCccceEEEEEEeCCceEEEEEcCCceEEEec--C
Q 001655 533 VLLCAFEGISYLLC-ALGDGHLLNFLLNMKTGELTDRKKVS----LGTQPITLRTFSSKNTTHVFAASDRPTVIYSS--N 605 (1036)
Q Consensus 533 i~~~~~~~~~~L~v-gl~~G~l~~y~~~~~~~~l~~~~~~~----lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~--~ 605 (1036)
|.-++..+.-.|++ |..||.+-.+.=. +++-... -|...|.=-.| ..++..++-.|.-..+-.+. .
T Consensus 264 i~~V~Ys~t~~lYvTaSkDG~IklwDGV------S~rCv~t~~~AH~gsevcSa~F-tkn~kyiLsSG~DS~vkLWEi~t 336 (430)
T KOG0640|consen 264 ITQVRYSSTGSLYVTASKDGAIKLWDGV------SNRCVRTIGNAHGGSEVCSAVF-TKNGKYILSSGKDSTVKLWEIST 336 (430)
T ss_pred eeEEEecCCccEEEEeccCCcEEeeccc------cHHHHHHHHhhcCCceeeeEEE-ccCCeEEeecCCcceeeeeeecC
Confidence 32222222333444 8899988776421 1111111 12222211112 11233344444333222222 2
Q ss_pred CcEE--Eeeecc---ccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEeCC--CccceEEEecCCCEEEEE
Q 001655 606 KKLL--YSNVNL---KEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIPLG--EHPRRICHQEQSRTFAIC 678 (1036)
Q Consensus 606 ~~~~--~~~~~~---~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~--~tp~~i~y~~~~~~~~v~ 678 (1036)
+|.. |+.-.. +....-+.||. ..+.+++.++..-.+|.-+..+.--.+..++| ..||-|.++|....|.-+
T Consensus 337 ~R~l~~YtGAg~tgrq~~rtqAvFNh--tEdyVl~pDEas~slcsWdaRtadr~~l~slgHn~a~R~i~HSP~~p~FmTc 414 (430)
T KOG0640|consen 337 GRMLKEYTGAGTTGRQKHRTQAVFNH--TEDYVLFPDEASNSLCSWDARTADRVALLSLGHNGAVRWIVHSPVEPAFMTC 414 (430)
T ss_pred CceEEEEecCCcccchhhhhhhhhcC--ccceEEccccccCceeeccccchhhhhhcccCCCCCceEEEeCCCCCceeee
Confidence 3322 221110 11223344543 23577778888888888776654445666776 468899999988877766
Q ss_pred Eee
Q 001655 679 SLK 681 (1036)
Q Consensus 679 ~~~ 681 (1036)
+.+
T Consensus 415 sdD 417 (430)
T KOG0640|consen 415 SDD 417 (430)
T ss_pred ccc
Confidence 544
No 93
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=91.14 E-value=47 Score=41.13 Aligned_cols=464 Identities=13% Similarity=0.130 Sum_probs=215.3
Q ss_pred CeEEEEEeecCeeEEEEeeCCCCCCCcEEEeee---cccCCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecCCce
Q 001655 260 AVVYIGSSYGDSQLIKLNLQPDAKGSYVEVLER---YVNLGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNGIGI 336 (1036)
Q Consensus 260 ~~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~~---l~n~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~gi~~ 336 (1036)
..+|++...||+ |+|+.++. ++..++ ..-|-|.-++++.... .+..+++.+.|.+ ..+-.++..
T Consensus 452 ~Tif~S~i~g~~-lvQvTs~~------iRl~ss~~~~~~W~~p~~~ti~~~~-~n~sqVvvA~~~~-----~l~y~~i~~ 518 (1096)
T KOG1897|consen 452 QTIFCSTINGNQ-LVQVTSNS------IRLVSSAGLRSEWRPPGKITIGVVS-ANASQVVVAGGGL-----ALFYLEIED 518 (1096)
T ss_pred ceEEEEccCCce-EEEEeccc------EEEEcchhhhhcccCCCceEEEEEe-ecceEEEEecCcc-----EEEEEEeec
Confidence 467888778887 89998743 555543 3567787777776543 3445777765522 222222222
Q ss_pred eEEEeeeCCCcceEEEeecCCCCCcccEEEEEecCceEEEEecCCCCeeeeeecCeeccccceeeeecCCC-eEEEEecC
Q 001655 337 NEQASVELQGIKGMWSLRSSTDDPFDTFLVVSFISETRILAMNLEDELEETEIEGFCSQTQTLFCHDAIYN-QLVQVTSG 415 (1036)
Q Consensus 337 ~~~~~~~l~~~~~iw~l~~~~~~~~~~~lv~S~~~~T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~-~~vQVt~~ 415 (1036)
..+... -- . -+..+-..|.+.. +.+..+ ..+-+++|.+.+- .++-..|+
T Consensus 519 ~~l~e~--------~~---------~-----~~e~evaCLDisp------~~d~~~--~s~~~aVG~Ws~~~~~l~~~pd 568 (1096)
T KOG1897|consen 519 GGLREV--------SH---------K-----EFEYEVACLDISP------LGDAPN--KSRLLAVGLWSDISMILTFLPD 568 (1096)
T ss_pred cceeee--------ee---------h-----eecceeEEEeccc------CCCCCC--cceEEEEEeecceEEEEEECCC
Confidence 111110 00 0 0111112222211 000111 1234556666443 56666677
Q ss_pred cEEEEecCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcC--cEEEEEEeccCCceeEEE-EcCCCCC
Q 001655 416 SVRLVSSTSRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVYLEIGD--GILTEVKHAQLEYEISCL-DINPIGE 490 (1036)
Q Consensus 416 ~i~l~~~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~--~~l~~~~~~~l~~~is~l-~~~~~~~ 490 (1036)
.+.+..... -.+. .| ++|....+. ..++++++.+|.+.+|.++. +++.+.++..+...+..+ .+..
T Consensus 569 ~~~~~~~~l---~~~~-iP--RSIl~~~~e~d~~yLlvalgdG~l~~fv~d~~tg~lsd~Kk~~lGt~P~~Lr~f~s--- 639 (1096)
T KOG1897|consen 569 LILITHEQL---SGEI-IP--RSILLTTFEGDIHYLLVALGDGALLYFVLDINTGQLSDRKKVTLGTQPISLRTFSS--- 639 (1096)
T ss_pred cceeeeecc---CCCc-cc--hheeeEEeeccceEEEEEcCCceEEEEEEEcccceEccccccccCCCCcEEEEEee---
Confidence 766654321 1111 12 467777655 46899999999999988876 667777777787766555 3321
Q ss_pred CCCcccEEEEEEecCCEEEEEECCCCCeeE----------EecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEec
Q 001655 491 NPSYSQIAAVGMWTDISVRIFSLPDLNLIT----------KEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 491 ~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~----------~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
++...++++- |.--.+|+-.+ ++++ ..++..+..|.+++.+ .+|.|....+|+
T Consensus 640 ---k~~t~vfa~s-drP~viY~~n~-kLv~spls~kev~~~c~f~s~a~~d~l~~~------------~~~~l~i~tid~ 702 (1096)
T KOG1897|consen 640 ---KSRTAVFALS-DRPTVIYSSNG-KLVYSPLSLKEVNHMCPFNSDAYPDSLASA------------NGGALTIGTIDE 702 (1096)
T ss_pred ---CCceEEEEeC-CCCEEEEecCC-cEEEeccchHHhhhhcccccccCCceEEEe------------cCCceEEEEecc
Confidence 1122222232 33344444332 1111 1122223344444333 355666666776
Q ss_pred CCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCCCCeEEEEeCCe
Q 001655 561 KTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGE 640 (1036)
Q Consensus 561 ~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~ 640 (1036)
.. ++. .+++.+|..|.++.. + .....+++++.|-= .... .+..+..-.++...+++.
T Consensus 703 iq-kl~-irtvpl~~~prrI~~-q-~~sl~~~v~s~r~e--------~~~~-----------~~~ee~~~s~l~vlD~nT 759 (1096)
T KOG1897|consen 703 IQ-KLH-IRTVPLGESPRRICY-Q-ESSLTFGVLSNRIE--------SSAE-----------YYGEEYEVSFLRVLDQNT 759 (1096)
T ss_pred hh-hcc-eeeecCCCChhheEe-c-ccceEEEEEecccc--------cchh-----------hcCCcceEEEEEEecCCc
Confidence 42 232 345788888766532 1 11222333332210 0000 011111112445556777
Q ss_pred EEEEEEcCCCCeEEEEEeCCCccceEE---EecC-CCEEEEEEeecCCCCCceeeEEEEEE---eCCCceEEEEEECCCC
Q 001655 641 LTIGTIDDIQKLHIRSIPLGEHPRRIC---HQEQ-SRTFAICSLKNQSCAEESEMHFVRLL---DDQTFEFISTYPLDTF 713 (1036)
Q Consensus 641 l~i~~l~~~~~~~~~~i~l~~tp~~i~---y~~~-~~~~~v~~~~~~~~~~~~~~~~l~l~---d~~t~~~i~~~~~~~~ 713 (1036)
+..........+ ++..+++ ++.+ ...|+|++.-..++..+-..+.+-++ +.++.+.++..+.+-
T Consensus 760 f~vl~~hef~~~--------E~~~Si~s~~~~~d~~t~~vVGT~~v~Pde~ep~~GRIivfe~~e~~~L~~v~e~~v~G- 830 (1096)
T KOG1897|consen 760 FEVLSSHEFERN--------ETALSIISCKFTDDPNTYYVVGTGLVYPDENEPVNGRIIVFEFEELNSLELVAETVVKG- 830 (1096)
T ss_pred eeEEeecccccc--------ceeeeeeeeeecCCCceEEEEEEEeeccCCCCcccceEEEEEEecCCceeeeeeeeecc-
Confidence 766666555433 2222232 3444 33456666654333333334444443 223344444333221
Q ss_pred CeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEEEEecCceeEeccccCeEEEEEC-CEE
Q 001655 714 EYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAEKETKGAVYSLNAFNGKLLAAIN-QKI 791 (1036)
Q Consensus 714 E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g-~~l 791 (1036)
.++++ +.| +..+++|-+ -.+-+|+...+ .|...+.....-.+..+...++.|++|-- ..+
T Consensus 831 -av~aL--~~f----ngkllA~In-----------~~vrLye~t~~~eLr~e~~~~~~~~aL~l~v~gdeI~VgDlm~Si 892 (1096)
T KOG1897|consen 831 -AVYAL--VEF----NGKLLAGIN-----------QSVRLYEWTTERELRIECNISNPIIALDLQVKGDEIAVGDLMRSI 892 (1096)
T ss_pred -ceeeh--hhh----CCeEEEecC-----------cEEEEEEccccceehhhhcccCCeEEEEEEecCcEEEEeeccceE
Confidence 22222 222 233444432 14456666544 34444433333334444555778877633 345
Q ss_pred EEEEeeecCCCccchhcccccccceEEEEEEE-eCCEEEEEeccccEEEEEEecc
Q 001655 792 QLYKWMLRDDGTRELQSECGHHGHILALYVQT-RGDFIVVGDLMKSISLLIYKHE 845 (1036)
Q Consensus 792 ~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~-~~~~I~vgD~~~Sv~~~~~~~~ 845 (1036)
.+..+... +|. +.-.|..-.+-+.++... .++..+.+|..--+.+++++.+
T Consensus 893 tll~y~~~-eg~--f~evArD~~p~Wmtaveil~~d~ylgae~~gNlf~v~~d~~ 944 (1096)
T KOG1897|consen 893 TLLQYKGD-EGN--FEEVARDYNPNWMTAVEILDDDTYLGAENSGNLFTVRKDSD 944 (1096)
T ss_pred EEEEEecc-CCc--eEEeehhhCccceeeEEEecCceEEeecccccEEEEEecCC
Confidence 55444322 221 222222212223333332 3556677888888888888753
No 94
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=90.72 E-value=21 Score=40.02 Aligned_cols=203 Identities=13% Similarity=0.110 Sum_probs=103.3
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEECCEEEEEEeeecC----CCc
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAINQKIQLYKWMLRD----DGT 803 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g~~l~v~~~~~~~----~~~ 803 (1036)
..|++.|| -+|.||+|++..++|-.+. ..+-.+|+++..- +|..++..|+.=.++-|...+ +..
T Consensus 93 G~~l~ag~----------i~g~lYlWelssG~LL~v~-~aHYQ~ITcL~fs~dgs~iiTgskDg~V~vW~l~~lv~a~~~ 161 (476)
T KOG0646|consen 93 GYFLLAGT----------ISGNLYLWELSSGILLNVL-SAHYQSITCLKFSDDGSHIITGSKDGAVLVWLLTDLVSADND 161 (476)
T ss_pred ceEEEeec----------ccCcEEEEEeccccHHHHH-HhhccceeEEEEeCCCcEEEecCCCccEEEEEEEeecccccC
Confidence 45666666 5689999999977653222 3455688888866 567777777654444453211 111
Q ss_pred cchhcccccccce-EEEEEEEe----CCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeC--ceEEEEc
Q 001655 804 RELQSECGHHGHI-LALYVQTR----GDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDD--DIYLGAE 876 (1036)
Q Consensus 804 ~~L~~~~~~~~~~-~~~~l~~~----~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~--~~~l~~D 876 (1036)
....+.+.+..+. .++++.+- +.+++..-.-+-+.++ +-..+.|..-. ..|+..+|+ .+|. ..+.++-
T Consensus 162 ~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~w--dlS~g~LLlti--~fp~si~av-~lDpae~~~yiGt 236 (476)
T KOG0646|consen 162 HSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLW--DLSLGVLLLTI--TFPSSIKAV-ALDPAERVVYIGT 236 (476)
T ss_pred CCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEE--EeccceeeEEE--ecCCcceeE-EEcccccEEEecC
Confidence 1122222233332 34445432 2356555555555443 32233332222 233333333 2333 2466677
Q ss_pred cCCcEEEEeeCCCCCCccc----ccce--eE--EEEEEcC-CccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEE
Q 001655 877 NNFNLFTVRKNSEGATDEE----RGRL--EV--VGEYHLG-EFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIA 947 (1036)
Q Consensus 877 ~~gnl~~l~~~~~~~~~~~----~~~L--~~--~~~~~lg-~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~ 947 (1036)
.+|+|++..+..-...+.+ +... .. ...=|-+ ..|+++.- ..+..-++-|..||.+-.--
T Consensus 237 ~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLai-----------s~DgtlLlSGd~dg~VcvWd 305 (476)
T KOG0646|consen 237 EEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAI-----------STDGTLLLSGDEDGKVCVWD 305 (476)
T ss_pred CcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEE-----------ecCccEEEeeCCCCCEEEEe
Confidence 8999999887654432210 0000 00 1111222 34555432 13456788888999887666
Q ss_pred ecChhHHHHHH
Q 001655 948 SLPHEQYLFLE 958 (1036)
Q Consensus 948 ~l~~~~~~~L~ 958 (1036)
+-+.+-.|.|.
T Consensus 306 i~S~Q~iRtl~ 316 (476)
T KOG0646|consen 306 IYSKQCIRTLQ 316 (476)
T ss_pred cchHHHHHHHh
Confidence 55655444443
No 95
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=90.22 E-value=25 Score=36.34 Aligned_cols=96 Identities=14% Similarity=0.149 Sum_probs=61.3
Q ss_pred CCeEEEEEEcCcEEEEEEeccCC-ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeE
Q 001655 455 GGHLVYLEIGDGILTEVKHAQLE-YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSV 533 (1036)
Q Consensus 455 ~~~~~~l~~~~~~l~~~~~~~l~-~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si 533 (1036)
...+.+|++..++-..+..++.. +.|+++.+.. .+.++.-|.. ||+++||.+..++. .-.+....+..++
T Consensus 60 ~qhvRlyD~~S~np~Pv~t~e~h~kNVtaVgF~~------dgrWMyTgse-Dgt~kIWdlR~~~~--qR~~~~~spVn~v 130 (311)
T KOG0315|consen 60 NQHVRLYDLNSNNPNPVATFEGHTKNVTAVGFQC------DGRWMYTGSE-DGTVKIWDLRSLSC--QRNYQHNSPVNTV 130 (311)
T ss_pred CCeeEEEEccCCCCCceeEEeccCCceEEEEEee------cCeEEEecCC-CceEEEEeccCccc--chhccCCCCcceE
Confidence 56677777765444344444443 5677777742 2566666666 99999999876432 1112212345566
Q ss_pred EeeeecCeEEEEEEeCCCcEEEEEEecC
Q 001655 534 LLCAFEGISYLLCALGDGHLLNFLLNMK 561 (1036)
Q Consensus 534 ~~~~~~~~~~L~vgl~~G~l~~y~~~~~ 561 (1036)
++.+ .+..|++|..+|.+-++.+...
T Consensus 131 vlhp--nQteLis~dqsg~irvWDl~~~ 156 (311)
T KOG0315|consen 131 VLHP--NQTELISGDQSGNIRVWDLGEN 156 (311)
T ss_pred EecC--CcceEEeecCCCcEEEEEccCC
Confidence 5553 4678999999999999887643
No 96
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=90.21 E-value=38 Score=38.52 Aligned_cols=100 Identities=18% Similarity=0.188 Sum_probs=60.0
Q ss_pred eCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeE-EEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEe
Q 001655 444 ANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEIS-CLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKE 522 (1036)
Q Consensus 444 ~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is-~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~ 522 (1036)
+.++.+++...++.+..++..+|+..=. .++...+. ...+ ....+++++. ++.+..++..+.+++++.
T Consensus 63 v~~~~v~v~~~~g~v~a~d~~tG~~~W~--~~~~~~~~~~p~v--------~~~~v~v~~~-~g~l~ald~~tG~~~W~~ 131 (377)
T TIGR03300 63 VAGGKVYAADADGTVVALDAETGKRLWR--VDLDERLSGGVGA--------DGGLVFVGTE-KGEVIALDAEDGKELWRA 131 (377)
T ss_pred EECCEEEEECCCCeEEEEEccCCcEeee--ecCCCCcccceEE--------cCCEEEEEcC-CCEEEEEECCCCcEeeee
Confidence 4467777777677777776655544322 22333221 1122 1457788888 899999998888888876
Q ss_pred cCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 523 HLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 523 ~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
.+..... .+..+ ....++++..+|.|+.+...
T Consensus 132 ~~~~~~~-~~p~v----~~~~v~v~~~~g~l~a~d~~ 163 (377)
T TIGR03300 132 KLSSEVL-SPPLV----ANGLVVVRTNDGRLTALDAA 163 (377)
T ss_pred ccCceee-cCCEE----ECCEEEEECCCCeEEEEEcC
Confidence 5543211 11111 13468889999988776654
No 97
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=89.69 E-value=35 Score=37.26 Aligned_cols=232 Identities=18% Similarity=0.215 Sum_probs=125.8
Q ss_pred CCeEEEEEEcC--cEEEEEEeccCCcee-EEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC-CCe--e-E-EecCCC
Q 001655 455 GGHLVYLEIGD--GILTEVKHAQLEYEI-SCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD-LNL--I-T-KEHLGG 526 (1036)
Q Consensus 455 ~~~~~~l~~~~--~~l~~~~~~~l~~~i-s~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~-l~~--v-~-~~~l~~ 526 (1036)
.+.+..|++|+ |+|..+.+..++... +.+++++ ...+++++.+..|++.+|.+.+ ..+ + . ..+...
T Consensus 63 ~ggvaay~iD~~~G~Lt~ln~~~~~g~~p~yvsvd~------~g~~vf~AnY~~g~v~v~p~~~dG~l~~~v~~~~h~g~ 136 (346)
T COG2706 63 EGGVAAYRIDPDDGRLTFLNRQTLPGSPPCYVSVDE------DGRFVFVANYHSGSVSVYPLQADGSLQPVVQVVKHTGS 136 (346)
T ss_pred cCcEEEEEEcCCCCeEEEeeccccCCCCCeEEEECC------CCCEEEEEEccCceEEEEEcccCCccccceeeeecCCC
Confidence 35566678875 889888887776655 5667653 3678999988889999999964 222 1 1 111211
Q ss_pred ---c--cC--ceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccce--eeecCccceEEEEEEeCCceEEEEEcCC
Q 001655 527 ---E--II--PRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRK--KVSLGTQPITLRTFSSKNTTHVFAASDR 597 (1036)
Q Consensus 527 ---~--~~--p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~--~~~lG~~pv~l~~~~~~~~~~v~~~~~~ 597 (1036)
+ .. +++..+.+- ++..+.+-|+-..+..|.++ +|.|.... ...-|.-|..+ .|+- +...+++.++=
T Consensus 137 ~p~~rQ~~~h~H~a~~tP~-~~~l~v~DLG~Dri~~y~~~--dg~L~~~~~~~v~~G~GPRHi-~FHp-n~k~aY~v~EL 211 (346)
T COG2706 137 GPHERQESPHVHSANFTPD-GRYLVVPDLGTDRIFLYDLD--DGKLTPADPAEVKPGAGPRHI-VFHP-NGKYAYLVNEL 211 (346)
T ss_pred CCCccccCCccceeeeCCC-CCEEEEeecCCceEEEEEcc--cCccccccccccCCCCCcceE-EEcC-CCcEEEEEecc
Confidence 0 01 233333321 23445568888899999988 45554332 22345545433 2322 34455555432
Q ss_pred --ceEEEecC---CcEEEe-eec-----cccceeeecccCCCCCCeEEEEe---CCeEEEEEEcCCC-Ce-EEEEEeCCC
Q 001655 598 --PTVIYSSN---KKLLYS-NVN-----LKEVSHMCPFNSAAFPDSLAIAK---EGELTIGTIDDIQ-KL-HIRSIPLGE 661 (1036)
Q Consensus 598 --p~~i~~~~---~~~~~~-~~~-----~~~i~~~~~f~~~~~~~~l~~~~---~~~l~i~~l~~~~-~~-~~~~i~l~~ 661 (1036)
...++..+ +++.-. .+. ...-...+.++....+. +++++ .+.|.+.+++... ++ .+...+..+
T Consensus 212 ~stV~v~~y~~~~g~~~~lQ~i~tlP~dF~g~~~~aaIhis~dGr-FLYasNRg~dsI~~f~V~~~~g~L~~~~~~~teg 290 (346)
T COG2706 212 NSTVDVLEYNPAVGKFEELQTIDTLPEDFTGTNWAAAIHISPDGR-FLYASNRGHDSIAVFSVDPDGGKLELVGITPTEG 290 (346)
T ss_pred CCEEEEEEEcCCCceEEEeeeeccCccccCCCCceeEEEECCCCC-EEEEecCCCCeEEEEEEcCCCCEEEEEEEeccCC
Confidence 22222222 333211 111 11122233333333333 55554 4789999998874 33 345566655
Q ss_pred -ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEE
Q 001655 662 -HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 662 -tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i 705 (1036)
+||-....+..+.++++--+ ...-.+--+|++|++.-
T Consensus 291 ~~PR~F~i~~~g~~Liaa~q~-------sd~i~vf~~d~~TG~L~ 328 (346)
T COG2706 291 QFPRDFNINPSGRFLIAANQK-------SDNITVFERDKETGRLT 328 (346)
T ss_pred cCCccceeCCCCCEEEEEccC-------CCcEEEEEEcCCCceEE
Confidence 59999998887766655321 12233444577777643
No 98
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=89.68 E-value=27 Score=36.31 Aligned_cols=106 Identities=16% Similarity=0.129 Sum_probs=63.8
Q ss_pred EEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCC
Q 001655 666 ICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENE 745 (1036)
Q Consensus 666 i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~ 745 (1036)
++..+++++++++.++. ..+.-+|+++++.+..-++...-+...+ + . ..++++|+
T Consensus 16 LVV~~dskT~v~igSHs---------~~~~avd~~sG~~~We~ilg~RiE~sa~--v-v----gdfVV~GC--------- 70 (354)
T KOG4649|consen 16 LVVCNDSKTLVVIGSHS---------GIVIAVDPQSGNLIWEAILGVRIECSAI--V-V----GDFVVLGC--------- 70 (354)
T ss_pred EEEecCCceEEEEecCC---------ceEEEecCCCCcEEeehhhCceeeeeeE--E-E----CCEEEEEE---------
Confidence 34456778999888764 4567789999888877666543332222 2 1 46799998
Q ss_pred CcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECCEEEEEEee
Q 001655 746 PTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQLYKWM 797 (1036)
Q Consensus 746 ~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~v~~~~ 797 (1036)
.+|.+|++.++.+..---+...-.-.+.+.+.+.+.|+.+-...=..|.++
T Consensus 71 -y~g~lYfl~~~tGs~~w~f~~~~~vk~~a~~d~~~glIycgshd~~~yalD 121 (354)
T KOG4649|consen 71 -YSGGLYFLCVKTGSQIWNFVILETVKVRAQCDFDGGLIYCGSHDGNFYALD 121 (354)
T ss_pred -ccCcEEEEEecchhheeeeeehhhhccceEEcCCCceEEEecCCCcEEEec
Confidence 678999999886532111111112234566677776665544333344443
No 99
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=89.62 E-value=32 Score=36.78 Aligned_cols=195 Identities=12% Similarity=0.110 Sum_probs=108.4
Q ss_pred EEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecC
Q 001655 692 HFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKG 771 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g 771 (1036)
+.+.+.+.++|+.+.++.=-.+. |+-+.. ...++=-+.||+- +.+-.|++.++|--.+.......
T Consensus 107 G~i~iw~~~~W~~~~slK~H~~~-Vt~lsi---HPS~KLALsVg~D-----------~~lr~WNLV~Gr~a~v~~L~~~a 171 (362)
T KOG0294|consen 107 GHIIIWRVGSWELLKSLKAHKGQ-VTDLSI---HPSGKLALSVGGD-----------QVLRTWNLVRGRVAFVLNLKNKA 171 (362)
T ss_pred CcEEEEEcCCeEEeeeecccccc-cceeEe---cCCCceEEEEcCC-----------ceeeeehhhcCccceeeccCCcc
Confidence 57888899999988876654444 544432 2223445566652 35556666554432222211111
Q ss_pred ceeEeccccCeEEEEECCEEEEEEeeecCCCccchhcccccccceEEEEEEE-eCCEEEEEeccccEEEEEEeccCCeEE
Q 001655 772 AVYSLNAFNGKLLAAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQT-RGDFIVVGDLMKSISLLIYKHEEGAIE 850 (1036)
Q Consensus 772 ~v~~i~~~~g~Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~-~~~~I~vgD~~~Sv~~~~~~~~~~~l~ 850 (1036)
-...-.+-+++.++..-++|-+|.++ ..++.+..... --+.++.. .+++++||=-..-+.+ ++.++ ...
T Consensus 172 t~v~w~~~Gd~F~v~~~~~i~i~q~d-----~A~v~~~i~~~--~r~l~~~~l~~~~L~vG~d~~~i~~--~D~ds-~~~ 241 (362)
T KOG0294|consen 172 TLVSWSPQGDHFVVSGRNKIDIYQLD-----NASVFREIENP--KRILCATFLDGSELLVGGDNEWISL--KDTDS-DTP 241 (362)
T ss_pred eeeEEcCCCCEEEEEeccEEEEEecc-----cHhHhhhhhcc--ccceeeeecCCceEEEecCCceEEE--eccCC-Ccc
Confidence 11111122457888889999999974 22333322211 11233333 3567777665555543 45443 111
Q ss_pred EEeccCCcceeEEEEEeeCc--e-EEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEe
Q 001655 851 ERARDYNANWMSAVEILDDD--I-YLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRH 916 (1036)
Q Consensus 851 ~~a~D~~~~~~~~~~~l~~~--~-~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~ 916 (1036)
+..-+.++..|-++.+..+. . ++.+-.+|-|.+...+.+.. .+-...+++++|.++|+++-
T Consensus 242 ~~~~~AH~~RVK~i~~~~~~~~~~lvTaSSDG~I~vWd~~~~~k-----~~~~~l~e~n~~~RltCl~~ 305 (362)
T KOG0294|consen 242 LTEFLAHENRVKDIASYTNPEHEYLVTASSDGFIKVWDIDMETK-----KRPTLLAELNTNVRLTCLRV 305 (362)
T ss_pred ceeeecchhheeeeEEEecCCceEEEEeccCceEEEEEcccccc-----CCcceeEEeecCCccceeee
Confidence 11223345556677755442 3 45677799999998875432 24557899999999999864
No 100
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=88.82 E-value=50 Score=37.90 Aligned_cols=104 Identities=15% Similarity=0.078 Sum_probs=57.8
Q ss_pred eCCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCcee---E-----EEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 444 ANASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEI---S-----CLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 444 ~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~i---s-----~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
+.++.+.+...++.+..++.++|+..=.. ++..+. + -++-.+. .....+.++.. ++.+.-++..+
T Consensus 67 v~~~~vy~~~~~g~l~ald~~tG~~~W~~--~~~~~~~~~~~~~~~~~~~~~~----v~~~~v~v~~~-~g~l~ald~~t 139 (394)
T PRK11138 67 VAYNKVYAADRAGLVKALDADTGKEIWSV--DLSEKDGWFSKNKSALLSGGVT----VAGGKVYIGSE-KGQVYALNAED 139 (394)
T ss_pred EECCEEEEECCCCeEEEEECCCCcEeeEE--cCCCcccccccccccccccccE----EECCEEEEEcC-CCEEEEEECCC
Confidence 45667777766677777776655432211 111100 0 0000000 01456778877 88888888888
Q ss_pred CCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 516 LNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 516 l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
-+++++..++.... .+..+. ...++++..+|.|+.+...
T Consensus 140 G~~~W~~~~~~~~~-ssP~v~----~~~v~v~~~~g~l~ald~~ 178 (394)
T PRK11138 140 GEVAWQTKVAGEAL-SRPVVS----DGLVLVHTSNGMLQALNES 178 (394)
T ss_pred CCCcccccCCCcee-cCCEEE----CCEEEEECCCCEEEEEEcc
Confidence 88888766653211 111222 3468889999987766543
No 101
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=88.71 E-value=25 Score=40.76 Aligned_cols=165 Identities=15% Similarity=0.130 Sum_probs=80.4
Q ss_pred eCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCCCCCeEEEEe-CCeEEEEEEcCCCCeEEEEEeCCCcc
Q 001655 585 SKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDDIQKLHIRSIPLGEHP 663 (1036)
Q Consensus 585 ~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~tp 663 (1036)
..++..|.++|+.-+.+++..+-..-. ..... .++ |.. .+.++..+ ++.+.|.+ ....-..++++++.++
T Consensus 41 npngr~v~V~g~geY~iyt~~~~r~k~--~G~g~-~~v-w~~---~n~yAv~~~~~~I~I~k--n~~~~~~k~i~~~~~~ 111 (443)
T PF04053_consen 41 NPNGRFVLVCGDGEYEIYTALAWRNKA--FGSGL-SFV-WSS---RNRYAVLESSSTIKIYK--NFKNEVVKSIKLPFSV 111 (443)
T ss_dssp -TTSSEEEEEETTEEEEEETTTTEEEE--EEE-S-EEE-E-T---SSEEEEE-TTS-EEEEE--TTEE-TT-----SS-E
T ss_pred CCCCCEEEEEcCCEEEEEEccCCcccc--cCcee-EEE-Eec---CccEEEEECCCeEEEEE--cCccccceEEcCCccc
Confidence 345678888999999999853221100 00111 111 111 23455554 56677642 2222234688888888
Q ss_pred ceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCC
Q 001655 664 RRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEE 743 (1036)
Q Consensus 664 ~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e 743 (1036)
.+|.+ ..++++.+. ..|.|+|-.+.+.+.+++.++ +.. ..|. +..+++++-|..
T Consensus 112 ~~If~---G~LL~~~~~-----------~~i~~yDw~~~~~i~~i~v~~---vk~-V~Ws---~~g~~val~t~~----- 165 (443)
T PF04053_consen 112 EKIFG---GNLLGVKSS-----------DFICFYDWETGKLIRRIDVSA---VKY-VIWS---DDGELVALVTKD----- 165 (443)
T ss_dssp EEEE----SSSEEEEET-----------TEEEEE-TTT--EEEEESS-E----EE-EEE----TTSSEEEEE-S------
T ss_pred ceEEc---CcEEEEECC-----------CCEEEEEhhHcceeeEEecCC---CcE-EEEE---CCCCEEEEEeCC-----
Confidence 88887 445555443 269999999999999988774 222 1342 346777777632
Q ss_pred CCCcceEEEEEEEeCC------------eEEEEEEEEecCceeEeccccCeEEEEECCEEE
Q 001655 744 NEPTKGRILVFIVEDG------------KLQLIAEKETKGAVYSLNAFNGKLLAAINQKIQ 792 (1036)
Q Consensus 744 ~~~~~Gri~v~~i~~~------------kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~l~ 792 (1036)
.+++++.+.. .++.++ ++...|.+.+=.++-++....+.|.
T Consensus 166 ------~i~il~~~~~~~~~~~~~g~e~~f~~~~--E~~~~IkSg~W~~d~fiYtT~~~lk 218 (443)
T PF04053_consen 166 ------SIYILKYNLEAVAAIPEEGVEDAFELIH--EISERIKSGCWVEDCFIYTTSNHLK 218 (443)
T ss_dssp ------SEEEEEE-HHHHHHBTTTB-GGGEEEEE--EE-S--SEEEEETTEEEEE-TTEEE
T ss_pred ------eEEEEEecchhcccccccCchhceEEEE--EecceeEEEEEEcCEEEEEcCCeEE
Confidence 4566666533 566665 3455566655445555666666554
No 102
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=88.60 E-value=69 Score=39.30 Aligned_cols=198 Identities=13% Similarity=0.086 Sum_probs=103.3
Q ss_pred CCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEE-EEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECC
Q 001655 436 GYSVNVATANASQVLLATGGGHLVYLEIGDGILT-EVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLP 514 (1036)
Q Consensus 436 ~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~-~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~ 514 (1036)
|..|.+.++....++.+...+.+..+.+++++.. .+.+++++-...|+.- .+.++++|.. |-.|.+.++.
T Consensus 56 g~~v~~ia~~s~~f~~~s~~~tv~~y~fps~~~~~iL~Rftlp~r~~~v~g--------~g~~iaagsd-D~~vK~~~~~ 126 (933)
T KOG1274|consen 56 GELVSSIACYSNHFLTGSEQNTVLRYKFPSGEEDTILARFTLPIRDLAVSG--------SGKMIAAGSD-DTAVKLLNLD 126 (933)
T ss_pred CceeEEEeecccceEEeeccceEEEeeCCCCCccceeeeeeccceEEEEec--------CCcEEEeecC-ceeEEEEecc
Confidence 4566777777777777777788877787764433 2445555544444432 2578888877 8889999988
Q ss_pred CCCeeEE-ecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCc--cccc--eeeecCccceEEEEEEeCCce
Q 001655 515 DLNLITK-EHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGE--LTDR--KKVSLGTQPITLRTFSSKNTT 589 (1036)
Q Consensus 515 ~l~~v~~-~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~--l~~~--~~~~lG~~pv~l~~~~~~~~~ 589 (1036)
|...... ... +...-.+-+. ..+..|-+.+-||.|.+|+++...-. +... ..-..-.+++.--.++-.++.
T Consensus 127 D~s~~~~lrgh--~apVl~l~~~--p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~ 202 (933)
T KOG1274|consen 127 DSSQEKVLRGH--DAPVLQLSYD--PKGNFLAVSSCDGKVQIWDLQDGILSKTLTGVDKDNEFILSRICTRLAWHPKGGT 202 (933)
T ss_pred ccchheeeccc--CCceeeeeEc--CCCCEEEEEecCceEEEEEcccchhhhhcccCCccccccccceeeeeeecCCCCe
Confidence 7433211 111 1122222222 24567888999999999998753211 1110 011111222221222223444
Q ss_pred EEEEEcCCceEEEecCCc---EEEeeeccccceeeecccCCCCCCeEEEEe-CCeEEEEEEcC
Q 001655 590 HVFAASDRPTVIYSSNKK---LLYSNVNLKEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDD 648 (1036)
Q Consensus 590 ~v~~~~~~p~~i~~~~~~---~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~ 648 (1036)
-.+.+.+.-..+|..++- +.+.+-......+.+.|. .++..++..+ ++++.+-..++
T Consensus 203 la~~~~d~~Vkvy~r~~we~~f~Lr~~~~ss~~~~~~ws--PnG~YiAAs~~~g~I~vWnv~t 263 (933)
T KOG1274|consen 203 LAVPPVDNTVKVYSRKGWELQFKLRDKLSSSKFSDLQWS--PNGKYIAASTLDGQILVWNVDT 263 (933)
T ss_pred EEeeccCCeEEEEccCCceeheeecccccccceEEEEEc--CCCcEEeeeccCCcEEEEeccc
Confidence 555566666666654332 122211111112233332 2334444433 67787777764
No 103
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=88.50 E-value=58 Score=38.25 Aligned_cols=180 Identities=17% Similarity=0.157 Sum_probs=98.4
Q ss_pred ceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEEEEEC--CEEEEEEeeecCCCccchhc-ccccccceEEEEEEE
Q 001655 748 KGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLLAAIN--QKIQLYKWMLRDDGTRELQS-ECGHHGHILALYVQT 823 (1036)
Q Consensus 748 ~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~-~~~~~~~~~~~~l~~ 823 (1036)
.+.+.+|++..+.-.+..-+.+..+|++++-. +|.++++.+ .+|++++.. . + +..+ ...+...+..++...
T Consensus 224 D~tiriwd~~~~~~~~~~l~gH~~~v~~~~f~p~g~~i~Sgs~D~tvriWd~~--~-~--~~~~~l~~hs~~is~~~f~~ 298 (456)
T KOG0266|consen 224 DKTLRIWDLKDDGRNLKTLKGHSTYVTSVAFSPDGNLLVSGSDDGTVRIWDVR--T-G--ECVRKLKGHSDGISGLAFSP 298 (456)
T ss_pred CceEEEeeccCCCeEEEEecCCCCceEEEEecCCCCEEEEecCCCcEEEEecc--C-C--eEEEeeeccCCceEEEEECC
Confidence 46888999943322222233788899998855 455555444 678886653 1 2 2222 233344445556666
Q ss_pred eCCEEEEEeccccEEEEEEeccCCe---EEEEeccCCcceeEEEEEeeCce-EEEEccCCcEEEEeeCCCCCCcccccce
Q 001655 824 RGDFIVVGDLMKSISLLIYKHEEGA---IEERARDYNANWMSAVEILDDDI-YLGAENNFNLFTVRKNSEGATDEERGRL 899 (1036)
Q Consensus 824 ~~~~I~vgD~~~Sv~~~~~~~~~~~---l~~~a~D~~~~~~~~~~~l~~~~-~l~~D~~gnl~~l~~~~~~~~~~~~~~L 899 (1036)
.+++++.++. ++.. .-|+...++ +..+..+..+..++.+.|=-+.. ++.+=.++.+.++.+.... .+
T Consensus 299 d~~~l~s~s~-d~~i-~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d~~~~~w~l~~~~-------~~ 369 (456)
T KOG0266|consen 299 DGNLLVSASY-DGTI-RVWDLETGSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLDRTLKLWDLRSGK-------SV 369 (456)
T ss_pred CCCEEEEcCC-CccE-EEEECCCCceeeeecccCCCCCCceeEEEECCCCcEEEEecCCCeEEEEEccCCc-------ce
Confidence 7889999965 5442 336776666 34555554444566776644444 4555456677776665321 11
Q ss_pred eEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEecCh
Q 001655 900 EVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASLPH 951 (1036)
Q Consensus 900 ~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l~~ 951 (1036)
..... |..+ +.++..-.. .....-++-|..+|.|...-+-+.
T Consensus 370 ~~~~~-~~~~-~~~~~~~~~--------~~~~~~i~sg~~d~~v~~~~~~s~ 411 (456)
T KOG0266|consen 370 GTYTG-HSNL-VRCIFSPTL--------STGGKLIYSGSEDGSVYVWDSSSG 411 (456)
T ss_pred eeecc-cCCc-ceeEecccc--------cCCCCeEEEEeCCceEEEEeCCcc
Confidence 11111 1111 223322111 224567788899999997766553
No 104
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=88.46 E-value=28 Score=40.42 Aligned_cols=181 Identities=14% Similarity=0.159 Sum_probs=94.7
Q ss_pred ccEEEEEecC--ceEEE--EecCCCCeeeeeecCeeccccceeeeecC--CCeEEEEecCcEEEEecCCccceeeeeCCC
Q 001655 362 DTFLVVSFIS--ETRIL--AMNLEDELEETEIEGFCSQTQTLFCHDAI--YNQLVQVTSGSVRLVSSTSRELRNEWKSPP 435 (1036)
Q Consensus 362 ~~~lv~S~~~--~T~vl--~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~--~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~ 435 (1036)
.+||....++ .+.|+ ++... ...+.|.....++.+..+. ..+++=.|...||+++...+..+.... +.
T Consensus 533 GDYlatV~~~~~~~~VliHQLSK~-----~sQ~PF~kskG~vq~v~FHPs~p~lfVaTq~~vRiYdL~kqelvKkL~-tg 606 (733)
T KOG0650|consen 533 GDYLATVMPDSGNKSVLIHQLSKR-----KSQSPFRKSKGLVQRVKFHPSKPYLFVATQRSVRIYDLSKQELVKKLL-TG 606 (733)
T ss_pred CceEEEeccCCCcceEEEEecccc-----cccCchhhcCCceeEEEecCCCceEEEEeccceEEEehhHHHHHHHHh-cC
Confidence 3577666663 23343 23221 1235666666666666663 347777899999999976533333222 12
Q ss_pred CCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCc-EEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEE
Q 001655 436 GYSVNVATAN--ASQVLLATGGGHLVYLEIGDG-ILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFS 512 (1036)
Q Consensus 436 ~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~-~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~ 512 (1036)
-.-|..-++. ++.+++...++.++.|+++-+ +--.. ..--+..+..+++.. .-..++.|.- ||++.||.
T Consensus 607 ~kwiS~msihp~GDnli~gs~d~k~~WfDldlsskPyk~-lr~H~~avr~Va~H~------ryPLfas~sd-Dgtv~Vfh 678 (733)
T KOG0650|consen 607 SKWISSMSIHPNGDNLILGSYDKKMCWFDLDLSSKPYKT-LRLHEKAVRSVAFHK------RYPLFASGSD-DGTVIVFH 678 (733)
T ss_pred CeeeeeeeecCCCCeEEEecCCCeeEEEEcccCcchhHH-hhhhhhhhhhhhhcc------ccceeeeecC-CCcEEEEe
Confidence 2235555554 578888777888888887531 10000 001123344555432 2345666655 78888875
Q ss_pred C---CCC----CeeEEecCCCccCceeEEeee--ec-CeEEEEEEeCCCcEEEE
Q 001655 513 L---PDL----NLITKEHLGGEIIPRSVLLCA--FE-GISYLLCALGDGHLLNF 556 (1036)
Q Consensus 513 l---~~l----~~v~~~~l~~~~~p~si~~~~--~~-~~~~L~vgl~~G~l~~y 556 (1036)
- .|| .++-...|.....-+++.++. +. ..++||..-+||.+-.|
T Consensus 679 g~VY~Dl~qnpliVPlK~L~gH~~~~~~gVLd~~wHP~qpWLfsAGAd~tirlf 732 (733)
T KOG0650|consen 679 GMVYNDLLQNPLIVPLKRLRGHEKTNDLGVLDTIWHPRQPWLFSAGADGTIRLF 732 (733)
T ss_pred eeeehhhhcCCceEeeeeccCceeecccceEeecccCCCceEEecCCCceEEee
Confidence 2 222 112122222211112332332 22 46889988888887655
No 105
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=88.43 E-value=58 Score=38.17 Aligned_cols=174 Identities=15% Similarity=0.141 Sum_probs=98.2
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEEEEeCCC--EEEEEEcCCeEEEEEEcCcEEEEEEecc-CCceeEEEEcCCCCC
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNVATANAS--QVLLATGGGHLVYLEIGDGILTEVKHAQ-LEYEISCLDINPIGE 490 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~--~vvv~~~~~~~~~l~~~~~~l~~~~~~~-l~~~is~l~~~~~~~ 490 (1036)
...||+++.++..++..+..-+ .=|.+-++.+. +++-+.++-.+.+..-++ +......++ -++-|-++++.|-+
T Consensus 76 D~~IrVfnynt~ekV~~FeAH~-DyIR~iavHPt~P~vLtsSDDm~iKlW~we~-~wa~~qtfeGH~HyVMqv~fnPkD- 152 (794)
T KOG0276|consen 76 DMQIRVFNYNTGEKVKTFEAHS-DYIRSIAVHPTLPYVLTSSDDMTIKLWDWEN-EWACEQTFEGHEHYVMQVAFNPKD- 152 (794)
T ss_pred CceEEEEecccceeeEEeeccc-cceeeeeecCCCCeEEecCCccEEEEeeccC-ceeeeeEEcCcceEEEEEEecCCC-
Confidence 4467889998888888776433 34777777754 455444444454444443 222211121 24567888987632
Q ss_pred CCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCcccccee
Q 001655 491 NPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKK 570 (1036)
Q Consensus 491 ~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~ 570 (1036)
.+..+-++- |.++.+|++..-.+.++-. +.+.-..++.+..-+++|||+-|..|-.+-++.....++- .+
T Consensus 153 ----~ntFaS~sL-DrTVKVWslgs~~~nfTl~-gHekGVN~Vdyy~~gdkpylIsgaDD~tiKvWDyQtk~CV----~T 222 (794)
T KOG0276|consen 153 ----PNTFASASL-DRTVKVWSLGSPHPNFTLE-GHEKGVNCVDYYTGGDKPYLISGADDLTIKVWDYQTKSCV----QT 222 (794)
T ss_pred ----ccceeeeec-cccEEEEEcCCCCCceeee-ccccCcceEEeccCCCcceEEecCCCceEEEeecchHHHH----HH
Confidence 233444444 8999999996544433211 1122345666666678999999998887777665432210 00
Q ss_pred eecCccceEEEEEEeCCceEEEEEcCCceEEEec-CCcEEE
Q 001655 571 VSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSS-NKKLLY 610 (1036)
Q Consensus 571 ~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~-~~~~~~ 610 (1036)
. -| +.++-+.++-..+-|+++..+ +|.+++
T Consensus 223 L-eG---------Ht~Nvs~v~fhp~lpiiisgsEDGTvri 253 (794)
T KOG0276|consen 223 L-EG---------HTNNVSFVFFHPELPIIISGSEDGTVRI 253 (794)
T ss_pred h-hc---------ccccceEEEecCCCcEEEEecCCccEEE
Confidence 0 01 122345666667777777655 455543
No 106
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=87.91 E-value=63 Score=38.03 Aligned_cols=40 Identities=10% Similarity=0.193 Sum_probs=28.4
Q ss_pred eEEEEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEee
Q 001655 632 SLAIAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLK 681 (1036)
Q Consensus 632 ~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~ 681 (1036)
++-+.+.+++++|++.....|.-. ++.+|.+..++++|-+
T Consensus 245 ~L~~fTR~GvrLGTvg~~D~WIWt----------V~~~PNsQ~v~~GCqD 284 (1081)
T KOG1538|consen 245 QLSLFTRDGVRLGTVGEQDSWIWT----------VQAKPNSQYVVVGCQD 284 (1081)
T ss_pred ceEEEeecCeEEeeccccceeEEE----------EEEccCCceEEEEEcc
Confidence 455566777788888776666332 4568899999999864
No 107
>PTZ00421 coronin; Provisional
Probab=87.54 E-value=68 Score=37.97 Aligned_cols=77 Identities=19% Similarity=0.110 Sum_probs=47.4
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeE-----EecCCC-ccCceeEEeeeecCeEEEEEEeCC
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLIT-----KEHLGG-EIIPRSVLLCAFEGISYLLCALGD 550 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~-----~~~l~~-~~~p~si~~~~~~~~~~L~vgl~~ 550 (1036)
...|.++++++.. ...++.|.+ |++|.+|++++..... ...+.. .....++.+.+. +..+|+.|..|
T Consensus 75 ~~~V~~v~fsP~d-----~~~LaSgS~-DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~-~~~iLaSgs~D 147 (493)
T PTZ00421 75 EGPIIDVAFNPFD-----PQKLFTASE-DGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPS-AMNVLASAGAD 147 (493)
T ss_pred CCCEEEEEEcCCC-----CCEEEEEeC-CCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcC-CCCEEEEEeCC
Confidence 4578899987532 457888888 9999999997532100 011111 112233333321 23578889999
Q ss_pred CcEEEEEEec
Q 001655 551 GHLLNFLLNM 560 (1036)
Q Consensus 551 G~l~~y~~~~ 560 (1036)
|.+..|.+..
T Consensus 148 gtVrIWDl~t 157 (493)
T PTZ00421 148 MVVNVWDVER 157 (493)
T ss_pred CEEEEEECCC
Confidence 9999988754
No 108
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=87.49 E-value=66 Score=37.76 Aligned_cols=243 Identities=19% Similarity=0.212 Sum_probs=128.1
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCC-CccCceeEEeeeecCeEEEEEEeCCCcEEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLG-GEIIPRSVLLCAFEGISYLLCALGDGHLLN 555 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~-~~~~p~si~~~~~~~~~~L~vgl~~G~l~~ 555 (1036)
...++|+++++ .+..++-+.+ ++.+.++.....+......+. ......++.+.. +..+++-+..|+.+-.
T Consensus 159 ~~sv~~~~fs~------~g~~l~~~~~-~~~i~~~~~~~~~~~~~~~l~~h~~~v~~~~fs~--d~~~l~s~s~D~tiri 229 (456)
T KOG0266|consen 159 CPSVTCVDFSP------DGRALAAASS-DGLIRIWKLEGIKSNLLRELSGHTRGVSDVAFSP--DGSYLLSGSDDKTLRI 229 (456)
T ss_pred cCceEEEEEcC------CCCeEEEccC-CCcEEEeecccccchhhccccccccceeeeEECC--CCcEEEEecCCceEEE
Confidence 35578888865 2456665556 899999988544410111111 112334444443 3448888999999999
Q ss_pred EEEecCCCccccceeeecCc-cceEEEEEEeCCceEEEEEc-CCceEEEecC-CcE-EEeeeccccceeeecccCCCCCC
Q 001655 556 FLLNMKTGELTDRKKVSLGT-QPITLRTFSSKNTTHVFAAS-DRPTVIYSSN-KKL-LYSNVNLKEVSHMCPFNSAAFPD 631 (1036)
Q Consensus 556 y~~~~~~~~l~~~~~~~lG~-~pv~l~~~~~~~~~~v~~~~-~~p~~i~~~~-~~~-~~~~~~~~~i~~~~~f~~~~~~~ 631 (1036)
+.+.. .+ +..++.. |- .+|.=..|...+ +-++..+ |....+..-+ +.. ...+.+.+.+.+ +.|+. ...
T Consensus 230 wd~~~-~~--~~~~~l~-gH~~~v~~~~f~p~g-~~i~Sgs~D~tvriWd~~~~~~~~~l~~hs~~is~-~~f~~--d~~ 301 (456)
T KOG0266|consen 230 WDLKD-DG--RNLKTLK-GHSTYVTSVAFSPDG-NLLVSGSDDGTVRIWDVRTGECVRKLKGHSDGISG-LAFSP--DGN 301 (456)
T ss_pred eeccC-CC--eEEEEec-CCCCceEEEEecCCC-CEEEEecCCCcEEEEeccCCeEEEeeeccCCceEE-EEECC--CCC
Confidence 88721 11 1112221 32 222112222222 2222222 3333333222 221 112222233332 23332 122
Q ss_pred eEEEEe-CCeEEEEEEcCCCCeEEEEEeCCCcc---ceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE
Q 001655 632 SLAIAK-EGELTIGTIDDIQKLHIRSIPLGEHP---RRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST 707 (1036)
Q Consensus 632 ~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~tp---~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~ 707 (1036)
.++..+ ++.+++-.+........+.+.-.+.+ +.+.++|+.+.+++++.. ..+++.|....+.+..
T Consensus 302 ~l~s~s~d~~i~vwd~~~~~~~~~~~~~~~~~~~~~~~~~fsp~~~~ll~~~~d----------~~~~~w~l~~~~~~~~ 371 (456)
T KOG0266|consen 302 LLVSASYDGTIRVWDLETGSKLCLKLLSGAENSAPVTSVQFSPNGKYLLSASLD----------RTLKLWDLRSGKSVGT 371 (456)
T ss_pred EEEEcCCCccEEEEECCCCceeeeecccCCCCCCceeEEEECCCCcEEEEecCC----------CeEEEEEccCCcceee
Confidence 333333 66777777665543333444545556 778889988877777654 4789988877777776
Q ss_pred EECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeC
Q 001655 708 YPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVED 758 (1036)
Q Consensus 708 ~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~ 758 (1036)
+.-..++ +.|+....+ ....++++.|. .-|.+++|....
T Consensus 372 ~~~~~~~-~~~~~~~~~-~~~~~~i~sg~----------~d~~v~~~~~~s 410 (456)
T KOG0266|consen 372 YTGHSNL-VRCIFSPTL-STGGKLIYSGS----------EDGSVYVWDSSS 410 (456)
T ss_pred ecccCCc-ceeEecccc-cCCCCeEEEEe----------CCceEEEEeCCc
Confidence 6655555 355544433 33567888886 347888888764
No 109
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=87.33 E-value=18 Score=38.85 Aligned_cols=123 Identities=19% Similarity=0.254 Sum_probs=75.2
Q ss_pred EEEEEECC-CCCeEeEEEEEEEcCC-CceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccC
Q 001655 704 FISTYPLD-TFEYGCSILSCSFSDD-SNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNG 781 (1036)
Q Consensus 704 ~i~~~~~~-~~E~v~si~~~~l~~~-~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g 781 (1036)
.+.+|.=+ ..|... -++|.++.. +.+|+|+|. .+|-|+++++..+++.-- -..+.+++..|.....
T Consensus 79 ~lq~y~D~d~~Esfy-tcsw~yd~~~~~p~la~~G----------~~GvIrVid~~~~~~~~~-~~ghG~sINeik~~p~ 146 (385)
T KOG1034|consen 79 LLQSYADEDHDESFY-TCSWSYDSNTGNPFLAAGG----------YLGVIRVIDVVSGQCSKN-YRGHGGSINEIKFHPD 146 (385)
T ss_pred eeeeccCCCCCcceE-EEEEEecCCCCCeeEEeec----------ceeEEEEEecchhhhccc-eeccCccchhhhcCCC
Confidence 33444333 344433 346777654 588999885 679999999886654321 1245667777776643
Q ss_pred --eEEEEEC--CEEEEEEeeecCCCccchh----cccccccceEEEEEEEeCCEEEEEeccccEEEEEEe
Q 001655 782 --KLLAAIN--QKIQLYKWMLRDDGTRELQ----SECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYK 843 (1036)
Q Consensus 782 --~Lv~~~g--~~l~v~~~~~~~~~~~~L~----~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~ 843 (1036)
.|+++.. +.|++++++ ++ ..+ ..-.++..+..+..+..+++|+-+-+-+|+.+.+.+
T Consensus 147 ~~qlvls~SkD~svRlwnI~--~~---~Cv~VfGG~egHrdeVLSvD~~~~gd~i~ScGmDhslk~W~l~ 211 (385)
T KOG1034|consen 147 RPQLVLSASKDHSVRLWNIQ--TD---VCVAVFGGVEGHRDEVLSVDFSLDGDRIASCGMDHSLKLWRLN 211 (385)
T ss_pred CCcEEEEecCCceEEEEecc--CC---eEEEEecccccccCcEEEEEEcCCCCeeeccCCcceEEEEecC
Confidence 3655444 678887653 11 111 111233344555666678999999999999988766
No 110
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=86.44 E-value=45 Score=34.78 Aligned_cols=172 Identities=12% Similarity=0.092 Sum_probs=93.4
Q ss_pred EEEEEEeCCCceEEEEEECCCC-CeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEec
Q 001655 692 HFVRLLDDQTFEFISTYPLDTF-EYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETK 770 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~~~~-E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~ 770 (1036)
+.|.-+|+.+++.+.++.+++. ....+. .+.. ..++++++ ..|.|+.+++..+++ +.+.+.+
T Consensus 3 g~l~~~d~~tG~~~W~~~~~~~~~~~~~~---~~~~--~~~v~~~~----------~~~~l~~~d~~tG~~--~W~~~~~ 65 (238)
T PF13360_consen 3 GTLSALDPRTGKELWSYDLGPGIGGPVAT---AVPD--GGRVYVAS----------GDGNLYALDAKTGKV--LWRFDLP 65 (238)
T ss_dssp SEEEEEETTTTEEEEEEECSSSCSSEEET---EEEE--TTEEEEEE----------TTSEEEEEETTTSEE--EEEEECS
T ss_pred CEEEEEECCCCCEEEEEECCCCCCCccce---EEEe--CCEEEEEc----------CCCEEEEEECCCCCE--EEEeecc
Confidence 4678899999999999998652 222211 1111 34555554 468899998877754 5555555
Q ss_pred CceeEe-ccccCeEEEEEC-CEEEEEEeeecCCCccchh-ccccc--ccceEEEEEEEeCCEEEEEeccccEEEEEEecc
Q 001655 771 GAVYSL-NAFNGKLLAAIN-QKIQLYKWMLRDDGTRELQ-SECGH--HGHILALYVQTRGDFIVVGDLMKSISLLIYKHE 845 (1036)
Q Consensus 771 g~v~~i-~~~~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~-~~~~~--~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~ 845 (1036)
+++... ...++.++++.. +.++. ++. .+|+..+. ..... ..........+.++++++++....+ +.++.+
T Consensus 66 ~~~~~~~~~~~~~v~v~~~~~~l~~--~d~-~tG~~~W~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~l--~~~d~~ 140 (238)
T PF13360_consen 66 GPISGAPVVDGGRVYVGTSDGSLYA--LDA-KTGKVLWSIYLTSSPPAGVRSSSSPAVDGDRLYVGTSSGKL--VALDPK 140 (238)
T ss_dssp SCGGSGEEEETTEEEEEETTSEEEE--EET-TTSCEEEEEEE-SSCTCSTB--SEEEEETTEEEEEETCSEE--EEEETT
T ss_pred ccccceeeecccccccccceeeeEe--ccc-CCcceeeeeccccccccccccccCceEecCEEEEEeccCcE--EEEecC
Confidence 554443 334678877764 44554 432 24544433 11110 0111223344458889888886555 456766
Q ss_pred CCeEEEEeccCCcce---------eEEEEEeeCceEEEEccCCcEEEEe
Q 001655 846 EGAIEERARDYNANW---------MSAVEILDDDIYLGAENNFNLFTVR 885 (1036)
Q Consensus 846 ~~~l~~~a~D~~~~~---------~~~~~~l~~~~~l~~D~~gnl~~l~ 885 (1036)
.+++.--..-..+.. ..+.-.+.++.+++++.+|.++.+.
T Consensus 141 tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~g~~~~~d 189 (238)
T PF13360_consen 141 TGKLLWKYPVGEPRGSSPISSFSDINGSPVISDGRVYVSSGDGRVVAVD 189 (238)
T ss_dssp TTEEEEEEESSTT-SS--EEEETTEEEEEECCTTEEEEECCTSSEEEEE
T ss_pred CCcEEEEeecCCCCCCcceeeecccccceEEECCEEEEEcCCCeEEEEE
Confidence 666532221112111 1233344456778888888755553
No 111
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=86.19 E-value=36 Score=36.35 Aligned_cols=149 Identities=13% Similarity=0.267 Sum_probs=78.4
Q ss_pred eEEEE-eCCeEEEEEEcCCC----CeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC--C----
Q 001655 632 SLAIA-KEGELTIGTIDDIQ----KLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD--Q---- 700 (1036)
Q Consensus 632 ~l~~~-~~~~l~i~~l~~~~----~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~--~---- 700 (1036)
.|+-+ .+..+++-.+.+.. +.....++.+ +|++++|.|+-+.++|.+.+- +.|+++-. +
T Consensus 100 ~lat~~~Dr~Ir~w~~~DF~~~eHr~~R~nve~d-hpT~V~FapDc~s~vv~~~~g---------~~l~vyk~~K~~dG~ 169 (420)
T KOG2096|consen 100 KLATISGDRSIRLWDVRDFENKEHRCIRQNVEYD-HPTRVVFAPDCKSVVVSVKRG---------NKLCVYKLVKKTDGS 169 (420)
T ss_pred eeEEEeCCceEEEEecchhhhhhhhHhhccccCC-CceEEEECCCcceEEEEEccC---------CEEEEEEeeecccCC
Confidence 45544 36778888887754 2333455665 999999999999999998642 34554421 1
Q ss_pred ---CceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEec
Q 001655 701 ---TFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLN 777 (1036)
Q Consensus 701 ---t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~ 777 (1036)
++..++-++|+....+.-+ .+.-.+...+++..+ ..-.|.+|..+..-|.-+...+.+.---++.
T Consensus 170 ~~~~~v~~D~~~f~~kh~v~~i---~iGiA~~~k~imsas---------~dt~i~lw~lkGq~L~~idtnq~~n~~aavS 237 (420)
T KOG2096|consen 170 GSHHFVHIDNLEFERKHQVDII---NIGIAGNAKYIMSAS---------LDTKICLWDLKGQLLQSIDTNQSSNYDAAVS 237 (420)
T ss_pred CCcccccccccccchhcccceE---EEeecCCceEEEEec---------CCCcEEEEecCCceeeeeccccccccceeeC
Confidence 1112233445444433222 121111222222221 1125677776644455454444433322333
Q ss_pred cccCeEEEEEC--CEEEEEEeeecCCCc
Q 001655 778 AFNGKLLAAIN--QKIQLYKWMLRDDGT 803 (1036)
Q Consensus 778 ~~~g~Lv~~~g--~~l~v~~~~~~~~~~ 803 (1036)
+ +|+.+++.| ..+.+|+.-...+|.
T Consensus 238 P-~GRFia~~gFTpDVkVwE~~f~kdG~ 264 (420)
T KOG2096|consen 238 P-DGRFIAVSGFTPDVKVWEPIFTKDGT 264 (420)
T ss_pred C-CCcEEEEecCCCCceEEEEEeccCcc
Confidence 2 677777777 567776665444443
No 112
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=85.96 E-value=54 Score=35.23 Aligned_cols=121 Identities=21% Similarity=0.329 Sum_probs=71.4
Q ss_pred CCCcEEEEEeC--CCEEEEEEcCCe-EEEEEEcCc-EEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEE
Q 001655 435 PGYSVNVATAN--ASQVLLATGGGH-LVYLEIGDG-ILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRI 510 (1036)
Q Consensus 435 ~~~~I~~as~~--~~~vvv~~~~~~-~~~l~~~~~-~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i 510 (1036)
.+..|.+.+.+ +..+.-+...|+ |..|...+| .+.|..+=.-..+|-|+++++ .+.+++|+.. .|+++|
T Consensus 180 H~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~RRG~d~A~iy~iaFSp------~~s~LavsSd-KgTlHi 252 (346)
T KOG2111|consen 180 HDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELRRGVDRADIYCIAFSP------NSSWLAVSSD-KGTLHI 252 (346)
T ss_pred ccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeeecCCchheEEEEEeCC------CccEEEEEcC-CCeEEE
Confidence 34578888876 444444444455 445555444 455655444457889999976 3678999887 899999
Q ss_pred EECCCCCe--e--EEecCCCccCce----------------eEEeeeecCe-EEEEEEeCCCcEEEEEEecCC
Q 001655 511 FSLPDLNL--I--TKEHLGGEIIPR----------------SVLLCAFEGI-SYLLCALGDGHLLNFLLNMKT 562 (1036)
Q Consensus 511 ~~l~~l~~--v--~~~~l~~~~~p~----------------si~~~~~~~~-~~L~vgl~~G~l~~y~~~~~~ 562 (1036)
|+|.+-+. - ++.++..-..|+ ..+++.++.+ ..+++-..||....|.+++.+
T Consensus 253 F~l~~~~~~~~~~SSl~~~~~~lpky~~S~wS~~~f~l~~~~~~~~~fg~~~nsvi~i~~Dgsy~k~~f~~~~ 325 (346)
T KOG2111|consen 253 FSLRDTENTEDESSSLSFKRLVLPKYFSSEWSFAKFQLPQGTQCIIAFGSETNTVIAICADGSYYKFKFDPKN 325 (346)
T ss_pred EEeecCCCCccccccccccccccchhcccceeEEEEEccCCCcEEEEecCCCCeEEEEEeCCcEEEEEecccc
Confidence 99975221 1 110000001111 1223445544 556655568999999998764
No 113
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=85.39 E-value=7.3 Score=42.56 Aligned_cols=90 Identities=23% Similarity=0.318 Sum_probs=65.5
Q ss_pred EEEEEEeCCCc-eEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEec
Q 001655 692 HFVRLLDDQTF-EFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETK 770 (1036)
Q Consensus 692 ~~l~l~d~~t~-~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~ 770 (1036)
+.++++|+... +++.++.|. |.+.+... +. ...++|++|+ ++|.+-.|+...+++-.+.-..+.
T Consensus 226 hqvR~YDt~~qRRPV~~fd~~--E~~is~~~--l~-p~gn~Iy~gn----------~~g~l~~FD~r~~kl~g~~~kg~t 290 (412)
T KOG3881|consen 226 HQVRLYDTRHQRRPVAQFDFL--ENPISSTG--LT-PSGNFIYTGN----------TKGQLAKFDLRGGKLLGCGLKGIT 290 (412)
T ss_pred eeEEEecCcccCcceeEeccc--cCcceeee--ec-CCCcEEEEec----------ccchhheecccCceeeccccCCcc
Confidence 68999999754 466666665 55544322 21 2356788886 678889999988888777778899
Q ss_pred CceeEeccccC-eEEEEEC--CEEEEEEe
Q 001655 771 GAVYSLNAFNG-KLLAAIN--QKIQLYKW 796 (1036)
Q Consensus 771 g~v~~i~~~~g-~Lv~~~g--~~l~v~~~ 796 (1036)
|.+++|....+ .+++++| .-|+||+.
T Consensus 291 Gsirsih~hp~~~~las~GLDRyvRIhD~ 319 (412)
T KOG3881|consen 291 GSIRSIHCHPTHPVLASCGLDRYVRIHDI 319 (412)
T ss_pred CCcceEEEcCCCceEEeeccceeEEEeec
Confidence 99999998865 6777776 56778875
No 114
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=84.52 E-value=25 Score=42.42 Aligned_cols=189 Identities=14% Similarity=0.123 Sum_probs=106.3
Q ss_pred EEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCC--CceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCC
Q 001655 666 ICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQ--TFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEE 743 (1036)
Q Consensus 666 i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~--t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e 743 (1036)
++... .+.|+++.... .....+++..+|+. +|..+... ...-.-.++ +.+ +...+|||.....
T Consensus 328 ~~~~~-~~lYv~GG~~~----~~~~l~~ve~YD~~~~~W~~~a~M--~~~R~~~~v--~~l---~g~iYavGG~dg~--- 392 (571)
T KOG4441|consen 328 VAVLN-GKLYVVGGYDS----GSDRLSSVERYDPRTNQWTPVAPM--NTKRSDFGV--AVL---DGKLYAVGGFDGE--- 392 (571)
T ss_pred EEEEC-CEEEEEccccC----CCcccceEEEecCCCCceeccCCc--cCcccccee--EEE---CCEEEEEeccccc---
Confidence 44443 35677665431 12344678888884 45443322 111111122 222 2578888865411
Q ss_pred CCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEEC--------CEEEEEEeeecCCCccchhcccccccc
Q 001655 744 NEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAIN--------QKIQLYKWMLRDDGTRELQSECGHHGH 815 (1036)
Q Consensus 744 ~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g--------~~l~v~~~~~~~~~~~~L~~~~~~~~~ 815 (1036)
..-..+-.|+...++.+.+......-.=.+++.++|+|++.-| +++..|+ +. .+.++. .+.+...
T Consensus 393 --~~l~svE~YDp~~~~W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~sve~YD--P~-t~~W~~--~~~M~~~ 465 (571)
T KOG4441|consen 393 --KSLNSVECYDPVTNKWTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLNSVECYD--PE-TNTWTL--IAPMNTR 465 (571)
T ss_pred --cccccEEEecCCCCcccccCCCCcceeeeEEEEECCEEEEEcCcCCCccccceEEEEc--CC-CCceee--cCCcccc
Confidence 1222455566667788888876665555677788999988877 3455555 32 233443 3323222
Q ss_pred eEEEEEEEeCCEEEE-Eecccc---EEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEc
Q 001655 816 ILALYVQTRGDFIVV-GDLMKS---ISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAE 876 (1036)
Q Consensus 816 ~~~~~l~~~~~~I~v-gD~~~S---v~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D 876 (1036)
-....+.+.+++|++ |..... -++-+|+++.++...++.-..++....+..++...++++-
T Consensus 466 R~~~g~a~~~~~iYvvGG~~~~~~~~~VE~ydp~~~~W~~v~~m~~~rs~~g~~~~~~~ly~vGG 530 (571)
T KOG4441|consen 466 RSGFGVAVLNGKIYVVGGFDGTSALSSVERYDPETNQWTMVAPMTSPRSAVGVVVLGGKLYAVGG 530 (571)
T ss_pred cccceEEEECCEEEEECCccCCCccceEEEEcCCCCceeEcccCccccccccEEEECCEEEEEec
Confidence 222336677888775 443221 1145789999999999877777777777777655555443
No 115
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=84.43 E-value=83 Score=36.07 Aligned_cols=180 Identities=12% Similarity=0.168 Sum_probs=91.6
Q ss_pred EEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEe-CCceEEEEEcCCceEEEecCCc------EEEeeecc-
Q 001655 544 LLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSS-KNTTHVFAASDRPTVIYSSNKK------LLYSNVNL- 615 (1036)
Q Consensus 544 L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~-~~~~~v~~~~~~p~~i~~~~~~------~~~~~~~~- 615 (1036)
.+-...||.|-.++++....++.-.+.+..|..-|....|.- .+..-+-+.|..-.+-.++.+. +.+..-+.
T Consensus 284 FlT~s~DgtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p~~~vk~AH~~ 363 (641)
T KOG0772|consen 284 FLTCSYDGTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRPVMKVKDAHLP 363 (641)
T ss_pred eEEecCCCcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCceeeeecCCcccccceEeeeccCC
Confidence 344445999999998754333433344444543333333321 1222222222222233333222 22211111
Q ss_pred -ccceeeecccCCCCCCe-EEEEe--CCeEEEEEEcCCCC-eEEEE-EeCCCccceEEEecCCCEEEEEEeecCCCCCce
Q 001655 616 -KEVSHMCPFNSAAFPDS-LAIAK--EGELTIGTIDDIQK-LHIRS-IPLGEHPRRICHQEQSRTFAICSLKNQSCAEES 689 (1036)
Q Consensus 616 -~~i~~~~~f~~~~~~~~-l~~~~--~~~l~i~~l~~~~~-~~~~~-i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~ 689 (1036)
..|.+++ |.. ++ .++.. ++.|++=.|...++ ++++. ++....-.-.+|+|+-++++.+++-.. ..
T Consensus 364 g~~Itsi~-FS~----dg~~LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~TGtS~~~----~~ 434 (641)
T KOG0772|consen 364 GQDITSIS-FSY----DGNYLLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILTGTSAPN----GM 434 (641)
T ss_pred CCceeEEE-ecc----ccchhhhccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEecccccC----CC
Confidence 1333322 221 22 22222 57788877776654 33332 222233455789999888777776431 11
Q ss_pred eeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEee
Q 001655 690 EMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTA 737 (1036)
Q Consensus 690 ~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~ 737 (1036)
....|.|+|..+++.+..+.+.....+- +.|.- +-+-|.+|++
T Consensus 435 ~~g~L~f~d~~t~d~v~ki~i~~aSvv~--~~Whp---kLNQi~~gsg 477 (641)
T KOG0772|consen 435 TAGTLFFFDRMTLDTVYKIDISTASVVR--CLWHP---KLNQIFAGSG 477 (641)
T ss_pred CCceEEEEeccceeeEEEecCCCceEEE--Eeecc---hhhheeeecC
Confidence 2347999999999999999888433322 34532 2345777875
No 116
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=84.35 E-value=9.1 Score=42.12 Aligned_cols=104 Identities=23% Similarity=0.388 Sum_probs=68.0
Q ss_pred EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEE
Q 001655 653 HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYY 732 (1036)
Q Consensus 653 ~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i 732 (1036)
..+.+|+++-...+-...+..-+ ..|++. -.+.++|..+.++...|.-+..--..-..-+.|. .+..|+
T Consensus 334 ~~~sv~~gg~vtSl~ls~~g~~l-LsssRD---------dtl~viDlRt~eI~~~~sA~g~k~asDwtrvvfS-pd~~Yv 402 (459)
T KOG0288|consen 334 KTRSVPLGGRVTSLDLSMDGLEL-LSSSRD---------DTLKVIDLRTKEIRQTFSAEGFKCASDWTRVVFS-PDGSYV 402 (459)
T ss_pred eeeEeecCcceeeEeeccCCeEE-eeecCC---------CceeeeecccccEEEEeeccccccccccceeEEC-CCCcee
Confidence 45778888766666666554433 333332 3688899888888876653322222222223444 357899
Q ss_pred EEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecC-ceeEec
Q 001655 733 CVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKG-AVYSLN 777 (1036)
Q Consensus 733 ~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g-~v~~i~ 777 (1036)
+-|. +.|++|+|++..+|++.+-+..... +++++.
T Consensus 403 aAGS----------~dgsv~iW~v~tgKlE~~l~~s~s~~aI~s~~ 438 (459)
T KOG0288|consen 403 AAGS----------ADGSVYIWSVFTGKLEKVLSLSTSNAAITSLS 438 (459)
T ss_pred eecc----------CCCcEEEEEccCceEEEEeccCCCCcceEEEE
Confidence 8886 5699999999999999888776655 666665
No 117
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=84.14 E-value=91 Score=36.31 Aligned_cols=253 Identities=17% Similarity=0.190 Sum_probs=127.5
Q ss_pred CCEEEEEEcCCeEEEE-EEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecC
Q 001655 446 ASQVLLATGGGHLVYL-EIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHL 524 (1036)
Q Consensus 446 ~~~vvv~~~~~~~~~l-~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l 524 (1036)
.+.+.|++ +.-+|+ ....+.+.++.... +..|+++..++ .+.+++||+- +|.++||+..+.+.+.....
T Consensus 188 ~n~laVal--g~~vylW~~~s~~v~~l~~~~-~~~vtSv~ws~------~G~~LavG~~-~g~v~iwD~~~~k~~~~~~~ 257 (484)
T KOG0305|consen 188 ANVLAVAL--GQSVYLWSASSGSVTELCSFG-EELVTSVKWSP------DGSHLAVGTS-DGTVQIWDVKEQKKTRTLRG 257 (484)
T ss_pred CCeEEEEe--cceEEEEecCCCceEEeEecC-CCceEEEEECC------CCCEEEEeec-CCeEEEEehhhccccccccC
Confidence 45667776 334454 33335555554443 77899998754 3789999999 99999999876544322111
Q ss_pred CCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccc---cceeeecCcc-ceEEEEEEeCC-ceEEEEEcCCce
Q 001655 525 GGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELT---DRKKVSLGTQ-PITLRTFSSKN-TTHVFAASDRPT 599 (1036)
Q Consensus 525 ~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~---~~~~~~lG~~-pv~l~~~~~~~-~~~v~~~~~~p~ 599 (1036)
. ..++-.+ .... ...+..|.++|.++.+.+........ ..+....|-+ ...-..+..++ .+.+++.-.
T Consensus 258 ~--h~~rvg~-laW~-~~~lssGsr~~~I~~~dvR~~~~~~~~~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~--- 330 (484)
T KOG0305|consen 258 S--HASRVGS-LAWN-SSVLSSGSRDGKILNHDVRISQHVVSTLQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDG--- 330 (484)
T ss_pred C--cCceeEE-Eecc-CceEEEecCCCcEEEEEEecchhhhhhhhcccceeeeeEECCCCCeeccCCCccceEeccC---
Confidence 1 1222111 1222 45688999999999998764321111 0000001100 00001111111 122322211
Q ss_pred EEEecCCcEEEeeecc-ccceeeecccCCCCCCeEEEEe----CCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCE
Q 001655 600 VIYSSNKKLLYSNVNL-KEVSHMCPFNSAAFPDSLAIAK----EGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRT 674 (1036)
Q Consensus 600 ~i~~~~~~~~~~~~~~-~~i~~~~~f~~~~~~~~l~~~~----~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~ 674 (1036)
....+.+.+..... --..+.||+.. +++.+- +..++|-... ..-.++.+..+.....++|++..+-
T Consensus 331 --~~~~p~~~~~~H~aAVKA~awcP~q~-----~lLAsGGGs~D~~i~fwn~~--~g~~i~~vdtgsQVcsL~Wsk~~kE 401 (484)
T KOG0305|consen 331 --LSPEPKFTFTEHTAAVKALAWCPWQS-----GLLATGGGSADRCIKFWNTN--TGARIDSVDTGSQVCSLIWSKKYKE 401 (484)
T ss_pred --CCccccEEEeccceeeeEeeeCCCcc-----CceEEcCCCcccEEEEEEcC--CCcEecccccCCceeeEEEcCCCCE
Confidence 01123344433221 01234566653 333322 3344444433 3456788888999999999999886
Q ss_pred EEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEee
Q 001655 675 FAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTA 737 (1036)
Q Consensus 675 ~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~ 737 (1036)
++..---. ...|.+.+-.+++.+... .....+++.+.. +...+++++|.+
T Consensus 402 i~sthG~s--------~n~i~lw~~ps~~~~~~l-~gH~~RVl~la~----SPdg~~i~t~a~ 451 (484)
T KOG0305|consen 402 LLSTHGYS--------ENQITLWKYPSMKLVAEL-LGHTSRVLYLAL----SPDGETIVTGAA 451 (484)
T ss_pred EEEecCCC--------CCcEEEEeccccceeeee-cCCcceeEEEEE----CCCCCEEEEecc
Confidence 66543211 125666665555443321 122334444432 123577888875
No 118
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=83.94 E-value=56 Score=33.70 Aligned_cols=205 Identities=15% Similarity=0.173 Sum_probs=109.2
Q ss_pred EECCCCCEEEEEecCCeEEEEeCCCC--Ccccc-----ceecccCCceEEEEEeecCCCCCEEEEEEEecCCcceEEEEE
Q 001655 70 IIDPDCRLIGLHLYDGLFKVIPFDNK--GQLKE-----AFNIRLEELQVLDIKFLYGCAKPTIVVLYQDNKDARHVKTYE 142 (1036)
Q Consensus 70 ~vdp~~r~~~~~~~~~~~~ilp~~~~--~~~~~-----~~~~~l~~~~i~d~~FL~~~~~ptlavL~~~~~~~~~l~~~~ 142 (1036)
++.|.+|+.+..-..|.++|+.+++- +.... .+.-+--+..+.+|+|-.. +++-. ....++.++
T Consensus 17 a~sp~~~~l~agn~~G~iav~sl~sl~s~sa~~~gk~~iv~eqahdgpiy~~~f~d~-----~Lls~----gdG~V~gw~ 87 (325)
T KOG0649|consen 17 AISPSKQYLFAGNLFGDIAVLSLKSLDSGSAEPPGKLKIVPEQAHDGPIYYLAFHDD-----FLLSG----GDGLVYGWE 87 (325)
T ss_pred hhCCcceEEEEecCCCeEEEEEehhhhccccCCCCCcceeeccccCCCeeeeeeehh-----heeec----cCceEEEee
Confidence 57888898877777899999988652 11111 1111223356777777421 12211 224566666
Q ss_pred EeccCCce-eeccccccccCCCCCEEEecCCCCcceEEEeCceEEEEcCCceeeeccCcceeeEEEEEecCCCEEEEEcC
Q 001655 143 VALKDKDF-VEGPWSQNNLDNGADLLIPVPPPLCGVLIIGEETIVYCSANAFKAIPIRPSITKAYGRVDADGSRYLLGDH 221 (1036)
Q Consensus 143 ~~~~~~~~-~~~~~~~~~lp~~~~~lip~p~~~~G~lv~~~~~i~y~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ll~~~ 221 (1036)
|+--.+.. ..+.|.. ..|.... .+|+|.. ....++...+.++++--
T Consensus 88 W~E~~es~~~K~lwe~-~~P~~~~-~~evPeI-------------------------------Nam~ldP~enSi~~AgG 134 (325)
T KOG0649|consen 88 WNEEEESLATKRLWEV-KIPMQVD-AVEVPEI-------------------------------NAMWLDPSENSILFAGG 134 (325)
T ss_pred ehhhhhhccchhhhhh-cCccccC-cccCCcc-------------------------------ceeEeccCCCcEEEecC
Confidence 64433212 2234542 1222211 3344421 11224545566777778
Q ss_pred ccCEEEEEEEecCcEEeeEEEEEcCccccceEEEE-ecCCeEEEEEeecCeeEEEEeeCCCCCCCcEEEeeeccc-----
Q 001655 222 AGLLHLLVITHEKEKVTGLKIELLGETSIASTISY-LDNAVVYIGSSYGDSQLIKLNLQPDAKGSYVEVLERYVN----- 295 (1036)
Q Consensus 222 ~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~-l~~~~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~~l~n----- 295 (1036)
||.+|.+.++. | .+.-++-|.+----|++- -.++-+|-|++-|--.++...... ..++++.+.|
T Consensus 135 D~~~y~~dlE~-G----~i~r~~rGHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k-----~v~~ie~yk~~~~lR 204 (325)
T KOG0649|consen 135 DGVIYQVDLED-G----RIQREYRGHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQK-----HVSMIEPYKNPNLLR 204 (325)
T ss_pred CeEEEEEEecC-C----EEEEEEcCCcceeeeeeecccCcceeecCCCccEEEEeccccc-----eeEEeccccChhhcC
Confidence 88888888853 2 244445555443334333 446778999998888887765422 2444444433
Q ss_pred --CCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecC
Q 001655 296 --LGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNG 333 (1036)
Q Consensus 296 --~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~g 333 (1036)
||--. +++.- ++=++.||.|+.-+|-.||..
T Consensus 205 p~~g~wi-gala~------~edWlvCGgGp~lslwhLrss 237 (325)
T KOG0649|consen 205 PDWGKWI-GALAV------NEDWLVCGGGPKLSLWHLRSS 237 (325)
T ss_pred cccCcee-EEEec------cCceEEecCCCceeEEeccCC
Confidence 33311 22211 122667899998877777664
No 119
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=83.47 E-value=1.1e+02 Score=36.63 Aligned_cols=80 Identities=19% Similarity=0.252 Sum_probs=47.6
Q ss_pred cCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCe--eEE-ecCCC-ccCce-eEEeeeecCeEEEEEEeC
Q 001655 475 QLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNL--ITK-EHLGG-EIIPR-SVLLCAFEGISYLLCALG 549 (1036)
Q Consensus 475 ~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~--v~~-~~l~~-~~~p~-si~~~~~~~~~~L~vgl~ 549 (1036)
.-..+|.|+.+.+.. ...++.|++ +|.+.+|.+....- .+. ..... ...|. .+.=........++.+..
T Consensus 240 ~~~s~v~~~~f~p~~-----p~ll~gG~y-~GqV~lWD~~~~~~~~~s~ls~~~~sh~~~v~~vvW~~~~~~~~f~s~ss 313 (555)
T KOG1587|consen 240 ESPSEVTCLKFCPFD-----PNLLAGGCY-NGQVVLWDLRKGSDTPPSGLSALEVSHSEPVTAVVWLQNEHNTEFFSLSS 313 (555)
T ss_pred ecCCceeEEEeccCC-----cceEEeecc-CceEEEEEccCCCCCCCcccccccccCCcCeEEEEEeccCCCCceEEEec
Confidence 345678899997743 578888999 99999999875332 211 11110 01111 111111112244777778
Q ss_pred CCcEEEEEEec
Q 001655 550 DGHLLNFLLNM 560 (1036)
Q Consensus 550 ~G~l~~y~~~~ 560 (1036)
||.+..+..+.
T Consensus 314 DG~i~~W~~~~ 324 (555)
T KOG1587|consen 314 DGSICSWDTDM 324 (555)
T ss_pred CCcEeeeeccc
Confidence 99999997764
No 120
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=83.46 E-value=1.3e+02 Score=37.76 Aligned_cols=142 Identities=18% Similarity=0.201 Sum_probs=80.9
Q ss_pred eEEEEeCCeEEEEEEcCC-CCeEEEEEeCCC--ccceE-EEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCc---eE
Q 001655 632 SLAIAKEGELTIGTIDDI-QKLHIRSIPLGE--HPRRI-CHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTF---EF 704 (1036)
Q Consensus 632 ~l~~~~~~~l~i~~l~~~-~~~~~~~i~l~~--tp~~i-~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~---~~ 704 (1036)
+.++++++ .++-++.+. ....++.||.+. .++.+ ++..+.+.+++++.+ ++|+++|...- ..
T Consensus 1178 G~Ll~tGd-~r~IRIWDa~~E~~~~diP~~s~t~vTaLS~~~~~gn~i~AGfaD----------GsvRvyD~R~a~~ds~ 1246 (1387)
T KOG1517|consen 1178 GHLLVTGD-VRSIRIWDAHKEQVVADIPYGSSTLVTALSADLVHGNIIAAGFAD----------GSVRVYDRRMAPPDSL 1246 (1387)
T ss_pred CeEEecCC-eeEEEEEecccceeEeecccCCCccceeecccccCCceEEEeecC----------CceEEeecccCCcccc
Confidence 55566655 555555443 356677777763 23333 245566788888765 58899886321 11
Q ss_pred EEEE-ECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeC-C---eEEEEEEEEecCceeEeccc
Q 001655 705 ISTY-PLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVED-G---KLQLIAEKETKGAVYSLNAF 779 (1036)
Q Consensus 705 i~~~-~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~-~---kl~~~~~~~~~g~v~~i~~~ 779 (1036)
+..+ ++...|. +..+++...+-.-++-| ...|+|+++++.- . -+.++...+..+..+++...
T Consensus 1247 v~~~R~h~~~~~---Iv~~slq~~G~~elvSg----------s~~G~I~~~DlR~~~~e~~~~iv~~~~yGs~lTal~VH 1313 (1387)
T KOG1517|consen 1247 VCVYREHNDVEP---IVHLSLQRQGLGELVSG----------SQDGDIQLLDLRMSSKETFLTIVAHWEYGSALTALTVH 1313 (1387)
T ss_pred ceeecccCCccc---ceeEEeecCCCcceeee----------ccCCeEEEEecccCcccccceeeeccccCccceeeeec
Confidence 2222 2333333 22333433222233333 3569999999984 2 24556666667789999877
Q ss_pred cC-eEEEE-ECCEEEEEEee
Q 001655 780 NG-KLLAA-INQKIQLYKWM 797 (1036)
Q Consensus 780 ~g-~Lv~~-~g~~l~v~~~~ 797 (1036)
.. .++++ .++.+.+|+..
T Consensus 1314 ~hapiiAsGs~q~ikIy~~~ 1333 (1387)
T KOG1517|consen 1314 EHAPIIASGSAQLIKIYSLS 1333 (1387)
T ss_pred cCCCeeeecCcceEEEEecC
Confidence 54 45544 44889999864
No 121
>PTZ00421 coronin; Provisional
Probab=83.36 E-value=1e+02 Score=36.41 Aligned_cols=113 Identities=14% Similarity=0.067 Sum_probs=68.1
Q ss_pred cEEEEEeC---CCEEEEEEcCCeEEEEEEcCcEEE-----EEEe-ccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEE
Q 001655 438 SVNVATAN---ASQVLLATGGGHLVYLEIGDGILT-----EVKH-AQLEYEISCLDINPIGENPSYSQIAAVGMWTDISV 508 (1036)
Q Consensus 438 ~I~~as~~---~~~vvv~~~~~~~~~l~~~~~~l~-----~~~~-~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i 508 (1036)
.|...+.+ +..++.+..++.+...++..+.+. .+.. ..-...|.++++.+. ...+++.|.+ |+.|
T Consensus 77 ~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~-----~~~iLaSgs~-DgtV 150 (493)
T PTZ00421 77 PIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPS-----AMNVLASAGA-DMVV 150 (493)
T ss_pred CEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcC-----CCCEEEEEeC-CCEE
Confidence 56666654 345655666777777777543211 1111 122456889988652 1357888888 9999
Q ss_pred EEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 509 RIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 509 ~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
.||++...+.+....-. .....++.+.. +...|..|..||.+..|.+.
T Consensus 151 rIWDl~tg~~~~~l~~h-~~~V~sla~sp--dG~lLatgs~Dg~IrIwD~r 198 (493)
T PTZ00421 151 NVWDVERGKAVEVIKCH-SDQITSLEWNL--DGSLLCTTSKDKKLNIIDPR 198 (493)
T ss_pred EEEECCCCeEEEEEcCC-CCceEEEEEEC--CCCEEEEecCCCEEEEEECC
Confidence 99999875543321111 12234454432 34578889999999887754
No 122
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=83.23 E-value=23 Score=39.02 Aligned_cols=253 Identities=16% Similarity=0.190 Sum_probs=130.2
Q ss_pred CeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCceEEEEEcCCceEEEecCCc-EEEeeeccccc
Q 001655 540 GISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAASDRPTVIYSSNKK-LLYSNVNLKEV 618 (1036)
Q Consensus 540 ~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~~~~-~~~~~~~~~~i 618 (1036)
+.-.|++|+..|.+.-++... +.+.-..+.=..||+ ++-...+.-|+|..+++. ++|...+...+
T Consensus 107 eGRRLltgs~SGEFtLWNg~~----fnFEtilQaHDs~Vr----------~m~ws~~g~wmiSgD~gG~iKyWqpnmnnV 172 (464)
T KOG0284|consen 107 EGRRLLTGSQSGEFTLWNGTS----FNFETILQAHDSPVR----------TMKWSHNGTWMISGDKGGMIKYWQPNMNNV 172 (464)
T ss_pred CCceeEeecccccEEEecCce----eeHHHHhhhhcccce----------eEEEccCCCEEEEcCCCceEEecccchhhh
Confidence 346799999999887765321 111001112233432 233334556777777654 55665554333
Q ss_pred eeeecccCCC-----C--CC--eEEEEeCCeEEEEEEcCCCCeEEEEEeC-CCccceEEEecCCCEEEEEEeecCCCCCc
Q 001655 619 SHMCPFNSAA-----F--PD--SLAIAKEGELTIGTIDDIQKLHIRSIPL-GEHPRRICHQEQSRTFAICSLKNQSCAEE 688 (1036)
Q Consensus 619 ~~~~~f~~~~-----~--~~--~l~~~~~~~l~i~~l~~~~~~~~~~i~l-~~tp~~i~y~~~~~~~~v~~~~~~~~~~~ 688 (1036)
..+-.-+.++ + .| ++-+.+++.++|=..-.. -..+.+.= |.-++.+.+||...+++.+.-+
T Consensus 173 k~~~ahh~eaIRdlafSpnDskF~t~SdDg~ikiWdf~~~--kee~vL~GHgwdVksvdWHP~kgLiasgskD------- 243 (464)
T KOG0284|consen 173 KIIQAHHAEAIRDLAFSPNDSKFLTCSDDGTIKIWDFRMP--KEERVLRGHGWDVKSVDWHPTKGLIASGSKD------- 243 (464)
T ss_pred HHhhHhhhhhhheeccCCCCceeEEecCCCeEEEEeccCC--chhheeccCCCCcceeccCCccceeEEccCC-------
Confidence 2221111111 1 12 233345677766443221 11222221 3578889999998877776543
Q ss_pred eeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEE-EE
Q 001655 689 SEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIA-EK 767 (1036)
Q Consensus 689 ~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~-~~ 767 (1036)
.-|+|.||++.+.+.+.- ++=.++-.++|..++ ++++-|.. | -.+.+|++. .++.+. ..
T Consensus 244 ---nlVKlWDprSg~cl~tlh----~HKntVl~~~f~~n~-N~Llt~sk------D----~~~kv~DiR--~mkEl~~~r 303 (464)
T KOG0284|consen 244 ---NLVKLWDPRSGSCLATLH----GHKNTVLAVKFNPNG-NWLLTGSK------D----QSCKVFDIR--TMKELFTYR 303 (464)
T ss_pred ---ceeEeecCCCcchhhhhh----hccceEEEEEEcCCC-CeeEEccC------C----ceEEEEehh--HhHHHHHhh
Confidence 289999999998876532 222455666676544 78876542 2 156677775 222222 22
Q ss_pred EecCceeEe--ccccCeEEEEEC--CEEEEEEeeecCCCccchhcc-cccccceEEEEEEEeCCEEEEEeccccEEE
Q 001655 768 ETKGAVYSL--NAFNGKLLAAIN--QKIQLYKWMLRDDGTRELQSE-CGHHGHILALYVQTRGDFIVVGDLMKSISL 839 (1036)
Q Consensus 768 ~~~g~v~~i--~~~~g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~~-~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~ 839 (1036)
..+.-|+++ .+++..|++..| ..|+.+.+.. .+.+... -.++..+..++-.-.|-.+.-|+--+.+-|
T Consensus 304 ~Hkkdv~~~~WhP~~~~lftsgg~Dgsvvh~~v~~----~~p~~~i~~AHd~~iwsl~~hPlGhil~tgsnd~t~rf 376 (464)
T KOG0284|consen 304 GHKKDVTSLTWHPLNESLFTSGGSDGSVVHWVVGL----EEPLGEIPPAHDGEIWSLAYHPLGHILATGSNDRTVRF 376 (464)
T ss_pred cchhhheeeccccccccceeeccCCCceEEEeccc----cccccCCCcccccceeeeeccccceeEeecCCCcceee
Confidence 345566666 566777766655 4566655531 1112111 112222222233334655556777776644
No 123
>PF06433 Me-amine-dh_H: Methylamine dehydrogenase heavy chain (MADH); InterPro: IPR009451 Methylamine dehydrogenase (1.4.99.3 from EC) is a periplasmic quinoprotein found in several methyltrophic bacteria []. It is induced when grown on methylamine as a carbon source MADH and catalyses the oxidative deamination of amines to their corresponding aldehydes. The redox cofactor of this enzyme is tryptophan tryptophylquinone (TTQ). Electrons derived from the oxidation of methylamine are passed to an electron acceptor, which is usually the blue-copper protein amicyanin (IPR002386 from INTERPRO). RCH2NH2 + H2O + acceptor = RCHO + NH3 + reduced acceptor MADH is a hetero-tetramer, comprised of two heavy subunits and two light subunits. The heavy subunit forms a seven-bladed beta-propeller like structure [].; GO: 0030058 amine dehydrogenase activity, 0030416 methylamine metabolic process, 0055114 oxidation-reduction process, 0042597 periplasmic space; PDB: 3RN1_F 3SVW_F 3PXT_F 3L4O_F 3L4M_D 3SJL_F 3PXS_D 3ORV_F 3RMZ_F 3RLM_F ....
Probab=82.87 E-value=81 Score=34.79 Aligned_cols=116 Identities=18% Similarity=0.133 Sum_probs=68.5
Q ss_pred eEEEEe-CCeEEEEEEcCCCCeEEEEEeCCC-----------ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC
Q 001655 632 SLAIAK-EGELTIGTIDDIQKLHIRSIPLGE-----------HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD 699 (1036)
Q Consensus 632 ~l~~~~-~~~l~i~~l~~~~~~~~~~i~l~~-----------tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~ 699 (1036)
.+++.+ ++.+.-..+.....-..++.++-. --.-++||+..+.+.|+..+............|-.+|.
T Consensus 197 ~~~F~Sy~G~v~~~dlsg~~~~~~~~~~~~t~~e~~~~WrPGG~Q~~A~~~~~~rlyvLMh~g~~gsHKdpgteVWv~D~ 276 (342)
T PF06433_consen 197 RLYFVSYEGNVYSADLSGDSAKFGKPWSLLTDAEKADGWRPGGWQLIAYHAASGRLYVLMHQGGEGSHKDPGTEVWVYDL 276 (342)
T ss_dssp EEEEEBTTSEEEEEEETTSSEEEEEEEESS-HHHHHTTEEE-SSS-EEEETTTTEEEEEEEE--TT-TTS-EEEEEEEET
T ss_pred eEEEEecCCEEEEEeccCCcccccCcccccCccccccCcCCcceeeeeeccccCeEEEEecCCCCCCccCCceEEEEEEC
Confidence 577776 788877777766533445555431 12448999888777676643221111224567888999
Q ss_pred CCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeE
Q 001655 700 QTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKL 761 (1036)
Q Consensus 700 ~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl 761 (1036)
++.+.+.+++++. .+.|| .+..+.+++++.-+. ..|-|++|+...+|+
T Consensus 277 ~t~krv~Ri~l~~--~~~Si---~Vsqd~~P~L~~~~~---------~~~~l~v~D~~tGk~ 324 (342)
T PF06433_consen 277 KTHKRVARIPLEH--PIDSI---AVSQDDKPLLYALSA---------GDGTLDVYDAATGKL 324 (342)
T ss_dssp TTTEEEEEEEEEE--EESEE---EEESSSS-EEEEEET---------TTTEEEEEETTT--E
T ss_pred CCCeEEEEEeCCC--ccceE---EEccCCCcEEEEEcC---------CCCeEEEEeCcCCcE
Confidence 9999999999863 24444 344555666653321 347888888776543
No 124
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=82.33 E-value=35 Score=37.13 Aligned_cols=70 Identities=19% Similarity=0.272 Sum_probs=42.9
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCe--e-EEecCCCccCceeEEeeeecCeEEEEEEeCCCcEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNL--I-TKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLL 554 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~--v-~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~ 554 (1036)
..|..++++|. +.-++-|.+ |.+|+||...+..- + +...+. +-+++.-..+..|++.|..||.+-
T Consensus 273 sAV~dVdfspt------G~Efvsgsy-DksIRIf~~~~~~SRdiYhtkRMq-----~V~~Vk~S~Dskyi~SGSdd~nvR 340 (433)
T KOG0268|consen 273 SAVMDVDFSPT------GQEFVSGSY-DKSIRIFPVNHGHSRDIYHTKRMQ-----HVFCVKYSMDSKYIISGSDDGNVR 340 (433)
T ss_pred eeEEEeccCCC------cchhccccc-cceEEEeecCCCcchhhhhHhhhh-----eeeEEEEeccccEEEecCCCccee
Confidence 34556677763 344566778 99999999876321 1 111111 111222223578999999999998
Q ss_pred EEEEe
Q 001655 555 NFLLN 559 (1036)
Q Consensus 555 ~y~~~ 559 (1036)
.++..
T Consensus 341 lWka~ 345 (433)
T KOG0268|consen 341 LWKAK 345 (433)
T ss_pred eeecc
Confidence 88754
No 125
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=82.23 E-value=1.2e+02 Score=37.24 Aligned_cols=211 Identities=18% Similarity=0.227 Sum_probs=100.8
Q ss_pred cEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEecc-CCce-eEEEEcCCCCCCCCcccEEEEEEecC--C-EEEEEE
Q 001655 438 SVNVATANASQVLLATGGGHLVYLEIGDGILTEVKHAQ-LEYE-ISCLDINPIGENPSYSQIAAVGMWTD--I-SVRIFS 512 (1036)
Q Consensus 438 ~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~-l~~~-is~l~~~~~~~~~~~~~~~~vg~w~~--~-~i~i~~ 512 (1036)
.|++++.+...|++....|.++.+. ..+.....+. .+.. +.-+-+. + +..-.+.||-... . .+.||+
T Consensus 27 ~isc~~s~~~~vvigt~~G~V~~Ln---~s~~~~~~fqa~~~siv~~L~~~---~--~~~~L~sv~Ed~~~np~llkiw~ 98 (933)
T KOG2114|consen 27 AISCCSSSTGSVVIGTADGRVVILN---SSFQLIRGFQAYEQSIVQFLYIL---N--KQNFLFSVGEDEQGNPVLLKIWD 98 (933)
T ss_pred ceeEEcCCCceEEEeeccccEEEec---ccceeeehheecchhhhhHhhcc---c--CceEEEEEeecCCCCceEEEEec
Confidence 6777777777888877777777653 1222211111 0111 2222111 0 1123445554422 1 578888
Q ss_pred CCCC---C-eeEE-----e--cCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEE
Q 001655 513 LPDL---N-LITK-----E--HLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLR 581 (1036)
Q Consensus 513 l~~l---~-~v~~-----~--~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~ 581 (1036)
++.. + +.+. . ..|.+..|-+++.+. ++-..+.||..||.++.|+=|.....-...+-..-|..|+.=-
T Consensus 99 lek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs-~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~~~~~~pITgL 177 (933)
T KOG2114|consen 99 LEKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVS-EDLKTIVCGFTNGLVICYKGDILRDRGSRQDYSHRGKEPITGL 177 (933)
T ss_pred ccccCCCCCcceeeeeeeeccCCCCCCCcceEEEEE-ccccEEEEEecCcEEEEEcCcchhccccceeeeccCCCCceee
Confidence 7642 2 2111 1 222233454443332 2345688999999999998654221111111223467776543
Q ss_pred EEEeCCceEEEEEcCCceEEEecCCc---EEEeeeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEe
Q 001655 582 TFSSKNTTHVFAASDRPTVIYSSNKK---LLYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIP 658 (1036)
Q Consensus 582 ~~~~~~~~~v~~~~~~p~~i~~~~~~---~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~ 658 (1036)
.+...+...+|+....-..+|.-.++ .....-+..++.+ ..|+ +.. ..|+++..+.|.+...+... +.-..+
T Consensus 178 ~~~~d~~s~lFv~Tt~~V~~y~l~gr~p~~~~ld~~G~~lnC-ss~~-~~t-~qfIca~~e~l~fY~sd~~~--~cfaf~ 252 (933)
T KOG2114|consen 178 ALRSDGKSVLFVATTEQVMLYSLSGRTPSLKVLDNNGISLNC-SSFS-DGT-YQFICAGSEFLYFYDSDGRG--PCFAFE 252 (933)
T ss_pred EEecCCceeEEEEecceeEEEEecCCCcceeeeccCCcccee-eecC-CCC-ccEEEecCceEEEEcCCCcc--eeeeec
Confidence 44444444477776665444433222 2211111111211 1111 111 14888888888888877432 233444
Q ss_pred CCCc
Q 001655 659 LGEH 662 (1036)
Q Consensus 659 l~~t 662 (1036)
+|+.
T Consensus 253 ~g~k 256 (933)
T KOG2114|consen 253 VGEK 256 (933)
T ss_pred CCCe
Confidence 4444
No 126
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=82.16 E-value=1.5e+02 Score=37.37 Aligned_cols=223 Identities=11% Similarity=0.128 Sum_probs=131.3
Q ss_pred ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEEC--CCCCeEeEEEEEEEcCCCceEEEEEeeee
Q 001655 662 HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPL--DTFEYGCSILSCSFSDDSNVYYCVGTAYV 739 (1036)
Q Consensus 662 tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~--~~~E~v~si~~~~l~~~~~~~i~VGT~~~ 739 (1036)
.|+.+.+||-...++++-. +..+++.|-...+.+..|.. .+.-.|+.++-+ +.....++++|+
T Consensus 1066 ~pk~~~~hpf~p~i~~ad~----------r~~i~vwd~e~~~~l~~F~n~~~~~t~Vs~l~li--Ne~D~aLlLtas--- 1130 (1387)
T KOG1517|consen 1066 PPKTLKFHPFEPQIAAADD----------RERIRVWDWEKGRLLNGFDNGAFPDTRVSDLELI--NEQDDALLLTAS--- 1130 (1387)
T ss_pred CCceeeecCCCceeEEcCC----------cceEEEEecccCceeccccCCCCCCCccceeeee--cccchhheeeec---
Confidence 4788889998887776642 24678887766666666543 344566666554 334578888887
Q ss_pred CCCCCCCcceEEEEEEEe-C--CeEEEEEEEE----------ecCceeEeccccCeEEEEECC-EEEEEEeeecCCCccc
Q 001655 740 LPEENEPTKGRILVFIVE-D--GKLQLIAEKE----------TKGAVYSLNAFNGKLLAAINQ-KIQLYKWMLRDDGTRE 805 (1036)
Q Consensus 740 ~~~e~~~~~Gri~v~~i~-~--~kl~~~~~~~----------~~g~v~~i~~~~g~Lv~~~g~-~l~v~~~~~~~~~~~~ 805 (1036)
+.|-|.+|+=- + ++.++|.... -.|.|+.=.+-.|+|+++-+. .|++++.. ...
T Consensus 1131 -------~dGvIRIwk~y~~~~~~~eLVTaw~~Ls~~~~~~r~~~~v~dWqQ~~G~Ll~tGd~r~IRIWDa~-----~E~ 1198 (1387)
T KOG1517|consen 1131 -------SDGVIRIWKDYADKWKKPELVTAWSSLSDQLPGARGTGLVVDWQQQSGHLLVTGDVRSIRIWDAH-----KEQ 1198 (1387)
T ss_pred -------cCceEEEecccccccCCceeEEeeccccccCccCCCCCeeeehhhhCCeEEecCCeeEEEEEecc-----cce
Confidence 45777777533 2 4667766432 123555656668888877653 34454421 111
Q ss_pred hhcccccccceEEEEEEE---eCCEEEEEeccccEEEEEEec-cCCeEEEEeccCCcc-eeEEEEEeeC--ceEEEEccC
Q 001655 806 LQSECGHHGHILALYVQT---RGDFIVVGDLMKSISLLIYKH-EEGAIEERARDYNAN-WMSAVEILDD--DIYLGAENN 878 (1036)
Q Consensus 806 L~~~~~~~~~~~~~~l~~---~~~~I~vgD~~~Sv~~~~~~~-~~~~l~~~a~D~~~~-~~~~~~~l~~--~~~l~~D~~ 878 (1036)
+....-+.+...+++|+. .||.|++|=.--|+-+|--+. .+..++-.-|-.... .+..+.+-.. +.++.+-.+
T Consensus 1199 ~~~diP~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~~~R~h~~~~~Iv~~slq~~G~~elvSgs~~ 1278 (1387)
T KOG1517|consen 1199 VVADIPYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVCVYREHNDVEPIVHLSLQRQGLGELVSGSQD 1278 (1387)
T ss_pred eEeecccCCCccceeecccccCCceEEEeecCCceEEeecccCCccccceeecccCCcccceeEEeecCCCcceeeeccC
Confidence 111111222334455443 479999999999988764332 234455555443332 1555555443 347777789
Q ss_pred CcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEE
Q 001655 879 FNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFR 915 (1036)
Q Consensus 879 gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~ 915 (1036)
|.+..++..-. . ...-+.....+.-|+-.|+|.
T Consensus 1279 G~I~~~DlR~~-~---~e~~~~iv~~~~yGs~lTal~ 1311 (1387)
T KOG1517|consen 1279 GDIQLLDLRMS-S---KETFLTIVAHWEYGSALTALT 1311 (1387)
T ss_pred CeEEEEecccC-c---ccccceeeeccccCccceeee
Confidence 99999886542 1 112455566666687676664
No 127
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=82.09 E-value=95 Score=35.06 Aligned_cols=240 Identities=17% Similarity=0.192 Sum_probs=124.1
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCc-cCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGE-IIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~-~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
.++.|+++++ ...|++-|-- +..++||...+++.+.. +..- -...++++- .+...|+.+..|..+-.|
T Consensus 203 keil~~avS~------Dgkylatgg~-d~~v~Iw~~~t~ehv~~--~~ghr~~V~~L~fr--~gt~~lys~s~Drsvkvw 271 (479)
T KOG0299|consen 203 KEILTLAVSS------DGKYLATGGR-DRHVQIWDCDTLEHVKV--FKGHRGAVSSLAFR--KGTSELYSASADRSVKVW 271 (479)
T ss_pred ceeEEEEEcC------CCcEEEecCC-CceEEEecCcccchhhc--ccccccceeeeeee--cCccceeeeecCCceEEE
Confidence 5778888864 2678888766 88999999988876532 1110 011223222 245679999999999999
Q ss_pred EEecCCCccccceeeecCccceEEEEEEeCCceEEEEEc--CCceEEE--ecCCcEEEeeeccccceeeecccCCCCCCe
Q 001655 557 LLNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAAS--DRPTVIY--SSNKKLLYSNVNLKEVSHMCPFNSAAFPDS 632 (1036)
Q Consensus 557 ~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~~--~~p~~i~--~~~~~~~~~~~~~~~i~~~~~f~~~~~~~~ 632 (1036)
.++... ... ...|-+.. +..+..-+...+.+.| |+...++ .+..++.|.+- ...+.+++-++.+ +.
T Consensus 272 ~~~~~s----~ve-tlyGHqd~-v~~IdaL~reR~vtVGgrDrT~rlwKi~eesqlifrg~-~~sidcv~~In~~---Hf 341 (479)
T KOG0299|consen 272 SIDQLS----YVE-TLYGHQDG-VLGIDALSRERCVTVGGRDRTVRLWKIPEESQLIFRGG-EGSIDCVAFINDE---HF 341 (479)
T ss_pred ehhHhH----HHH-HHhCCccc-eeeechhcccceEEeccccceeEEEeccccceeeeeCC-CCCeeeEEEeccc---ce
Confidence 887532 100 11222221 1111111122333333 4444333 23455666542 2345555544432 12
Q ss_pred EEEEeCCeEEEEEEcCCCCeEEEEEeCCCcc-----------ceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC-C
Q 001655 633 LAIAKEGELTIGTIDDIQKLHIRSIPLGEHP-----------RRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD-Q 700 (1036)
Q Consensus 633 l~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp-----------~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~-~ 700 (1036)
+.-.+++.+-+=.+-....+.+.+++=+-.| ..++-.+.+++++-.+ +.++|+|.-- .
T Consensus 342 vsGSdnG~IaLWs~~KKkplf~~~~AHgv~~~~~~~~~~~Witsla~i~~sdL~asGS----------~~G~vrLW~i~~ 411 (479)
T KOG0299|consen 342 VSGSDNGSIALWSLLKKKPLFTSRLAHGVIPELDPVNGNFWITSLAVIPGSDLLASGS----------WSGCVRLWKIED 411 (479)
T ss_pred eeccCCceEEEeeecccCceeEeeccccccCCccccccccceeeeEecccCceEEecC----------CCCceEEEEecC
Confidence 3334456666555555555666665543332 2345556666555443 3468888632 2
Q ss_pred C---ceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCe
Q 001655 701 T---FEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGK 760 (1036)
Q Consensus 701 t---~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~k 760 (1036)
. ++.+.++.+ .=.|+++ .|..+ ...|++|++. ++.-||-....-..++
T Consensus 412 g~r~i~~l~~ls~--~GfVNsl---~f~~s-gk~ivagiGk------EhRlGRW~~~k~~~~~ 462 (479)
T KOG0299|consen 412 GLRAINLLYSLSL--VGFVNSL---AFSNS-GKRIVAGIGK------EHRLGRWWCLKSGKNS 462 (479)
T ss_pred Cccccceeeeccc--ccEEEEE---EEccC-CCEEEEeccc------ccccceeeEeeccccc
Confidence 2 334443332 2334444 34332 3489999874 3567887665444333
No 128
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=82.03 E-value=59 Score=35.25 Aligned_cols=141 Identities=23% Similarity=0.294 Sum_probs=82.1
Q ss_pred EEEecCcEEEEecCCccceeeeeCCCC--CcEEEEEe-CCCEEEEEEcCCeEEEEEEcCcEEEEEEeccC----CceeEE
Q 001655 410 VQVTSGSVRLVSSTSRELRNEWKSPPG--YSVNVATA-NASQVLLATGGGHLVYLEIGDGILTEVKHAQL----EYEISC 482 (1036)
Q Consensus 410 vQVt~~~i~l~~~~~~~~~~~w~~~~~--~~I~~as~-~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l----~~~is~ 482 (1036)
+-....+||+++..+++.+.+++.+.+ ..+..+++ .+..|+.+.++|.+..+++.. ..++.++.. +..-+|
T Consensus 45 v~lSngsv~lyd~~tg~~l~~fk~~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs--~~e~a~~~~~~~~~~~f~~ 122 (376)
T KOG1188|consen 45 VSLSNGSVRLYDKGTGQLLEEFKGPPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRS--QAESARISWTQQSGTPFIC 122 (376)
T ss_pred EEecCCeEEEEeccchhhhheecCCCCcccceEEecCCCCCeeEEeccCCeEEEEEeec--chhhhheeccCCCCCcceE
Confidence 334467899999988777877764432 23455555 466777777889998887743 112222222 223468
Q ss_pred EEcCCCCCCCCcccEEEEEEec---CCEEEEEECCCCCe-eE--EecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 483 LDINPIGENPSYSQIAAVGMWT---DISVRIFSLPDLNL-IT--KEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 483 l~~~~~~~~~~~~~~~~vg~w~---~~~i~i~~l~~l~~-v~--~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
++..- +...++.|+-. +-.+.+|++..-+. +. .+.-.. -..++.+.+. +...|+-|.-||.+-.|
T Consensus 123 ld~nc------k~~ii~~GtE~~~s~A~v~lwDvR~~qq~l~~~~eSH~D--DVT~lrFHP~-~pnlLlSGSvDGLvnlf 193 (376)
T KOG1188|consen 123 LDLNC------KKNIIACGTELTRSDASVVLWDVRSEQQLLRQLNESHND--DVTQLRFHPS-DPNLLLSGSVDGLVNLF 193 (376)
T ss_pred eeccC------cCCeEEeccccccCceEEEEEEeccccchhhhhhhhccC--cceeEEecCC-CCCeEEeecccceEEee
Confidence 87632 25567777643 34677777765322 21 111111 1234444432 34568889999999999
Q ss_pred EEecC
Q 001655 557 LLNMK 561 (1036)
Q Consensus 557 ~~~~~ 561 (1036)
.....
T Consensus 194 D~~~d 198 (376)
T KOG1188|consen 194 DTKKD 198 (376)
T ss_pred ecCCC
Confidence 87643
No 129
>PF12894 Apc4_WD40: Anaphase-promoting complex subunit 4 WD40 domain
Probab=81.95 E-value=3.8 Score=30.70 Aligned_cols=38 Identities=24% Similarity=0.417 Sum_probs=30.8
Q ss_pred EEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECC
Q 001655 470 EVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLP 514 (1036)
Q Consensus 470 ~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~ 514 (1036)
.+....+..+|++++.+| .-+.+++|+. +|.|.+|.+.
T Consensus 4 ~~~~k~l~~~v~~~~w~P------~mdLiA~~t~-~g~v~v~Rl~ 41 (47)
T PF12894_consen 4 QLGEKNLPSRVSCMSWCP------TMDLIALGTE-DGEVLVYRLN 41 (47)
T ss_pred eecccCCCCcEEEEEECC------CCCEEEEEEC-CCeEEEEECC
Confidence 445566778899999977 3679999998 9999999983
No 130
>PF14761 HPS3_N: Hermansky-Pudlak syndrome 3
Probab=81.87 E-value=65 Score=32.96 Aligned_cols=165 Identities=14% Similarity=0.126 Sum_probs=85.5
Q ss_pred EeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCe
Q 001655 636 AKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEY 715 (1036)
Q Consensus 636 ~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~ 715 (1036)
+.+..+....+.....-..-+++.-++..+++|.+..+.++-+..+.... ....+|.+- +|+.. ..++.
T Consensus 35 ~~g~~Vev~~l~~~~~~~~~~F~Tv~~V~~l~y~~~GDYlvTlE~k~~~~----~~~fvR~Y~--NWr~~-----~~~~~ 103 (215)
T PF14761_consen 35 ASGCKVEVYDLEQEECPLLCTFSTVGRVLQLVYSEAGDYLVTLEEKNKRS----PVDFVRAYF--NWRSQ-----KEENS 103 (215)
T ss_pred cCCCEEEEEEcccCCCceeEEEcchhheeEEEeccccceEEEEEeecCCc----cceEEEEEE--Ehhhh-----cccCC
Confidence 44566666666633333445566667788999999888666665443111 011555552 34432 11222
Q ss_pred EeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeE--eccccCeEEEEECCEEEE
Q 001655 716 GCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYS--LNAFNGKLLAAINQKIQL 793 (1036)
Q Consensus 716 v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~--i~~~~g~Lv~~~g~~l~v 793 (1036)
..++ -++|.....+ -.++.+.. ++ +-+...+.++.+ .|+..|.|++|+++++.+
T Consensus 104 ~v~v------------RiaG~~v~~~-~~~~~~~q----------le-iiElPl~~~p~ciaCC~~tG~LlVg~~~~l~l 159 (215)
T PF14761_consen 104 PVRV------------RIAGHRVTPS-FNESSKDQ----------LE-IIELPLSEPPLCIACCPVTGNLLVGCGNKLVL 159 (215)
T ss_pred cEEE------------EEcccccccC-CCCccccc----------eE-EEEecCCCCCCEEEecCCCCCEEEEcCCEEEE
Confidence 2222 2235321110 01111112 22 223455556654 467799999999999999
Q ss_pred EEeeecCCCccch--hc----ccccccceEEEEEEEeCCEEEEEeccc
Q 001655 794 YKWMLRDDGTREL--QS----ECGHHGHILALYVQTRGDFIVVGDLMK 835 (1036)
Q Consensus 794 ~~~~~~~~~~~~L--~~----~~~~~~~~~~~~l~~~~~~I~vgD~~~ 835 (1036)
|.+....-...++ .. .......+.+..+...++||.+-+-..
T Consensus 160 f~l~~~~~~~~~~~~lDFe~~l~~~~~~~~p~~v~ic~~yiA~~s~~e 207 (215)
T PF14761_consen 160 FTLKYQTIQSEKFSFLDFERSLIDHIDNFKPTQVAICEGYIAVMSDLE 207 (215)
T ss_pred EEEEEEEEecccccEEechhhhhheecCceEEEEEEEeeEEEEecCCE
Confidence 9985321101111 11 111122345778888899988755444
No 131
>PHA02713 hypothetical protein; Provisional
Probab=81.31 E-value=39 Score=40.78 Aligned_cols=150 Identities=12% Similarity=0.107 Sum_probs=82.2
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECC-------------------
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQ------------------- 789 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~------------------- 789 (1036)
...+++|... +. .....+..|+...++.+.+.....+-.-.+++.++|+|++.-|.
T Consensus 352 g~IYviGG~~---~~--~~~~sve~Ydp~~~~W~~~~~mp~~r~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~ 426 (557)
T PHA02713 352 DTIYAIGGQN---GT--NVERTIECYTMGDDKWKMLPDMPIALSSYGMCVLDQYIYIIGGRTEHIDYTSVHHMNSIDMEE 426 (557)
T ss_pred CEEEEECCcC---CC--CCCceEEEEECCCCeEEECCCCCcccccccEEEECCEEEEEeCCCcccccccccccccccccc
Confidence 5678888642 11 12335777877777777665443332223455668888765552
Q ss_pred ------EEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEE-Eecc---ccE-EEEEEeccC-CeEEEEeccCC
Q 001655 790 ------KIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVV-GDLM---KSI-SLLIYKHEE-GAIEERARDYN 857 (1036)
Q Consensus 790 ------~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~---~Sv-~~~~~~~~~-~~l~~~a~D~~ 857 (1036)
++..|+ +.. .. +...+.....-....+.+.++.|+| |... ... .+.+|+++. ++...++.=+.
T Consensus 427 ~~~~~~~ve~YD--P~t-d~--W~~v~~m~~~r~~~~~~~~~~~IYv~GG~~~~~~~~~~ve~Ydp~~~~~W~~~~~m~~ 501 (557)
T PHA02713 427 DTHSSNKVIRYD--TVN-NI--WETLPNFWTGTIRPGVVSHKDDIYVVCDIKDEKNVKTCIFRYNTNTYNGWELITTTES 501 (557)
T ss_pred cccccceEEEEC--CCC-Ce--EeecCCCCcccccCcEEEECCEEEEEeCCCCCCccceeEEEecCCCCCCeeEccccCc
Confidence 233343 322 22 3333322222122345677887765 5332 111 356899987 78998887777
Q ss_pred cceeEEEEEeeCceEEEEccCCcEEEEeeCC
Q 001655 858 ANWMSAVEILDDDIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 858 ~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~ 888 (1036)
+|....+..+++.-++++..+|.-.+-.|++
T Consensus 502 ~r~~~~~~~~~~~iyv~Gg~~~~~~~e~yd~ 532 (557)
T PHA02713 502 RLSALHTILHDNTIMMLHCYESYMLQDTFNV 532 (557)
T ss_pred ccccceeEEECCEEEEEeeecceeehhhcCc
Confidence 7777777777655555554455433334443
No 132
>KOG1896 consensus mRNA cleavage and polyadenylation factor II complex, subunit CFT1 (CPSF subunit) [RNA processing and modification]
Probab=81.28 E-value=1.7e+02 Score=37.45 Aligned_cols=94 Identities=19% Similarity=0.205 Sum_probs=67.9
Q ss_pred EEEEEEEe-CCeEEEEEEEEecCceeEeccccCeEEEE-ECCEEEEEEeeecCCCccch--hcccccccceEEEEEEEeC
Q 001655 750 RILVFIVE-DGKLQLIAEKETKGAVYSLNAFNGKLLAA-INQKIQLYKWMLRDDGTREL--QSECGHHGHILALYVQTRG 825 (1036)
Q Consensus 750 ri~v~~i~-~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~-~g~~l~v~~~~~~~~~~~~L--~~~~~~~~~~~~~~l~~~~ 825 (1036)
.|+++.++ +..|.=++-.+.+--|+++..+++.|++| +=+.+.+..|+++ -.+| ..+.+-....+++..-+.|
T Consensus 1117 KI~v~~l~r~~~ligVaFiD~~~yv~s~~~vknlIl~gDV~ksisfl~fqee---p~rlsL~srd~~~l~v~s~EFLVdg 1193 (1366)
T KOG1896|consen 1117 KIIVRKLDRDSELIGVAFIDLPLYVHSMKVVKNLILAGDVMKSISFLGFQEE---PYRLSLLSRDFEPLNVYSTEFLVDG 1193 (1366)
T ss_pred EEEEEEeccCCcceeeEEeccceeEEehhhhhhheehhhhhhceEEEEEccC---ceEEEEeecCCchhhceeeeeEEcC
Confidence 68889884 55677677677788888999999998877 4477888888642 2333 3333323344666666777
Q ss_pred C--EEEEEeccccEEEEEEeccC
Q 001655 826 D--FIVVGDLMKSISLLIYKHEE 846 (1036)
Q Consensus 826 ~--~I~vgD~~~Sv~~~~~~~~~ 846 (1036)
+ ..+|.|+.+-+.++.|.++.
T Consensus 1194 ~~L~flvsDa~rNi~vy~Y~Pe~ 1216 (1366)
T KOG1896|consen 1194 SNLSFLVSDADRNIHVYMYAPEN 1216 (1366)
T ss_pred CeeEEEEEcCCCcEEEEEeCCCC
Confidence 6 67899999999999999863
No 133
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=81.22 E-value=33 Score=41.46 Aligned_cols=174 Identities=17% Similarity=0.148 Sum_probs=100.7
Q ss_pred eeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEe
Q 001655 690 EMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKET 769 (1036)
Q Consensus 690 ~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~ 769 (1036)
....++.+|+.+.+-...-+++..-.-.+++.+ +...+++|.-.. .....-.+..|+...++...+.+...
T Consensus 299 ~~~~ve~yd~~~~~w~~~a~m~~~r~~~~~~~~-----~~~lYv~GG~~~----~~~~l~~ve~YD~~~~~W~~~a~M~~ 369 (571)
T KOG4441|consen 299 SLRSVECYDPKTNEWSSLAPMPSPRCRVGVAVL-----NGKLYVVGGYDS----GSDRLSSVERYDPRTNQWTPVAPMNT 369 (571)
T ss_pred ccceeEEecCCcCcEeecCCCCcccccccEEEE-----CCEEEEEccccC----CCcccceEEEecCCCCceeccCCccC
Confidence 345788888865432222233322222333333 246777775431 12344567777777666666665555
Q ss_pred cCceeEeccccCeEEEEECC-------EEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEE--E-e----ccc
Q 001655 770 KGAVYSLNAFNGKLLAAINQ-------KIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVV--G-D----LMK 835 (1036)
Q Consensus 770 ~g~v~~i~~~~g~Lv~~~g~-------~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~v--g-D----~~~ 835 (1036)
.-.=.+++.++|.|++.-|. ++..|+. . ..++...+.+...-......+.+++|++ | | ..+
T Consensus 370 ~R~~~~v~~l~g~iYavGG~dg~~~l~svE~YDp--~---~~~W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~l~ 444 (571)
T KOG4441|consen 370 KRSDFGVAVLDGKLYAVGGFDGEKSLNSVECYDP--V---TNKWTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNCLN 444 (571)
T ss_pred ccccceeEEECCEEEEEeccccccccccEEEecC--C---CCcccccCCCCcceeeeEEEEECCEEEEEcCcCCCccccc
Confidence 55555555566666554443 2444442 2 2334444444444445566777887765 3 1 334
Q ss_pred cEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCC
Q 001655 836 SISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNF 879 (1036)
Q Consensus 836 Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~g 879 (1036)
| +..|++..++...++.=..+|....+..+++.-++++..+|
T Consensus 445 s--ve~YDP~t~~W~~~~~M~~~R~~~g~a~~~~~iYvvGG~~~ 486 (571)
T KOG4441|consen 445 S--VECYDPETNTWTLIAPMNTRRSGFGVAVLNGKIYVVGGFDG 486 (571)
T ss_pred e--EEEEcCCCCceeecCCcccccccceEEEECCEEEEECCccC
Confidence 4 45789999999999988888888888888766666655554
No 134
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=81.15 E-value=98 Score=34.59 Aligned_cols=73 Identities=12% Similarity=0.180 Sum_probs=46.3
Q ss_pred CCCCeEEEEeCCeEEEEEEcCCCC-eEEEEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEE
Q 001655 628 AFPDSLAIAKEGELTIGTIDDIQK-LHIRSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 628 ~~~~~l~~~~~~~l~i~~l~~~~~-~~~~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i 705 (1036)
..|+|+-++++++=..|++.+..+ -..-.||=. .-+.+|.|.|..+.|.+-++-. .++++.+..+|..+
T Consensus 353 fsPNGy~lATgs~Dnt~kVWDLR~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~TasyD---------~t~kiWs~~~~~~~ 423 (459)
T KOG0272|consen 353 FSPNGYHLATGSSDNTCKVWDLRMRSELYTIPAHSNLVSQVKYSPQEGYFLVTASYD---------NTVKIWSTRTWSPL 423 (459)
T ss_pred ECCCceEEeecCCCCcEEEeeecccccceecccccchhhheEecccCCeEEEEcccC---------cceeeecCCCcccc
Confidence 347888777754444444444321 113344432 2467899999888887776532 58999999999887
Q ss_pred EEEE
Q 001655 706 STYP 709 (1036)
Q Consensus 706 ~~~~ 709 (1036)
.+..
T Consensus 424 ksLa 427 (459)
T KOG0272|consen 424 KSLA 427 (459)
T ss_pred hhhc
Confidence 6543
No 135
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=80.24 E-value=1.6e+02 Score=36.74 Aligned_cols=96 Identities=18% Similarity=0.244 Sum_probs=64.4
Q ss_pred CeEEE--EecCcEEEEecCCccceeeeeCCCCCcEEEEE-------eCCCEEEEEEcCCeEEEEEEcC----cEEEEE--
Q 001655 407 NQLVQ--VTSGSVRLVSSTSRELRNEWKSPPGYSVNVAT-------ANASQVLLATGGGHLVYLEIGD----GILTEV-- 471 (1036)
Q Consensus 407 ~~~vQ--Vt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as-------~~~~~vvv~~~~~~~~~l~~~~----~~l~~~-- 471 (1036)
++++| ..++.+.-+|.+.++.+.+|+...+..|..-+ ..+.+.+++.+++.+.. +|+ .++...
T Consensus 494 ~mil~~~~~~~~ly~mDLe~GKVV~eW~~~~~~~v~~~~p~~K~aqlt~e~tflGls~n~lfr--iDpR~~~~k~v~~~~ 571 (794)
T PF08553_consen 494 NMILLDPNNPNKLYKMDLERGKVVEEWKVHDDIPVVDIAPDSKFAQLTNEQTFLGLSDNSLFR--IDPRLSGNKLVDSQS 571 (794)
T ss_pred ceEeecCCCCCceEEEecCCCcEEEEeecCCCcceeEecccccccccCCCceEEEECCCceEE--eccCCCCCceeeccc
Confidence 46666 35788888999999999999986654444332 23567888888777654 444 223321
Q ss_pred EeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEE
Q 001655 472 KHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFS 512 (1036)
Q Consensus 472 ~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~ 512 (1036)
........-+|++-. ...+++||.- +|.|++|+
T Consensus 572 k~Y~~~~~Fs~~aTt-------~~G~iavgs~-~G~IRLyd 604 (794)
T PF08553_consen 572 KQYSSKNNFSCFATT-------EDGYIAVGSN-KGDIRLYD 604 (794)
T ss_pred cccccCCCceEEEec-------CCceEEEEeC-CCcEEeec
Confidence 122233456788764 2568999988 99999997
No 136
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=79.80 E-value=1.3e+02 Score=35.24 Aligned_cols=186 Identities=14% Similarity=0.119 Sum_probs=111.4
Q ss_pred ccceEEEecCCCEEEEEEeec--C-----CCCCceeeEEEEEEeC--CCceEEEEEECCCCCeEeEEEEEEEcC-CCceE
Q 001655 662 HPRRICHQEQSRTFAICSLKN--Q-----SCAEESEMHFVRLLDD--QTFEFISTYPLDTFEYGCSILSCSFSD-DSNVY 731 (1036)
Q Consensus 662 tp~~i~y~~~~~~~~v~~~~~--~-----~~~~~~~~~~l~l~d~--~t~~~i~~~~~~~~E~v~si~~~~l~~-~~~~~ 731 (1036)
..|+++..+..+.++|=-... + +...+.++.-+.++.- ..++.+..+.-+-+. ..+.|.. +.++.
T Consensus 147 ~~r~l~~N~~qDl~ivWW~~~~~e~~PWsP~~~e~draNl~L~~~~~~klEvL~yirTE~dP-----l~~~Fs~~~~~qi 221 (545)
T PF11768_consen 147 LERHLSVNSSQDLVIVWWPSAQDEVWPWSPISSEKDRANLHLLSCSGGKLEVLSYIRTENDP-----LDVEFSLNQPYQI 221 (545)
T ss_pred cceeEeeccCCCEEEEEecCCCCCcCCCCCccccchhccEEEEEecCCcEEEEEEEEecCCc-----EEEEccCCCCcEE
Confidence 456777776666655443221 1 2223344455555532 345666665444333 1234443 45778
Q ss_pred EEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEE--EecCceeEeccc--cCeEE-EEECCEEEEEEeeecCCCccch
Q 001655 732 YCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEK--ETKGAVYSLNAF--NGKLL-AAINQKIQLYKWMLRDDGTREL 806 (1036)
Q Consensus 732 i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~--~~~g~v~~i~~~--~g~Lv-~~~g~~l~v~~~~~~~~~~~~L 806 (1036)
..|.-.....+| ..=.-.+|++.++|++-+... ..+.+|.+.+-- ..+|+ .|....|.+|+-. .++
T Consensus 222 ~tVE~s~s~~g~---~~~d~ciYE~~r~klqrvsvtsipL~s~v~~ca~sp~E~kLvlGC~DgSiiLyD~~------~~~ 292 (545)
T PF11768_consen 222 HTVEQSISVKGE---PSADSCIYECSRNKLQRVSVTSIPLPSQVICCARSPSEDKLVLGCEDGSIILYDTT------RGV 292 (545)
T ss_pred EEEEEecCCCCC---ceeEEEEEEeecCceeEEEEEEEecCCcceEEecCcccceEEEEecCCeEEEEEcC------CCe
Confidence 888877665444 344556788888888865544 557777776643 44665 5667899998842 112
Q ss_pred hcccccccceEEEEEEE--eCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEE
Q 001655 807 QSECGHHGHILALYVQT--RGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSA 863 (1036)
Q Consensus 807 ~~~~~~~~~~~~~~l~~--~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~ 863 (1036)
...+ +....|+.+.+ .|..++||.-+-=+.++-.--.+-++..++.|..|..+..
T Consensus 293 t~~~--ka~~~P~~iaWHp~gai~~V~s~qGelQ~FD~ALspi~~qLlsEd~~P~~~L~ 349 (545)
T PF11768_consen 293 TLLA--KAEFIPTLIAWHPDGAIFVVGSEQGELQCFDMALSPIKMQLLSEDATPKSTLQ 349 (545)
T ss_pred eeee--eecccceEEEEcCCCcEEEEEcCCceEEEEEeecCccceeeccccCCCccEEe
Confidence 1111 22334666666 4569999999888887654446677888888988877643
No 137
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=79.75 E-value=23 Score=38.94 Aligned_cols=131 Identities=10% Similarity=0.151 Sum_probs=71.4
Q ss_pred ecCceeEeccccCeEEEEECC-EEEEEEeeecCCCccchhcccccccceEEEEEEE-eCCEEEEEecc--ccEEEEEEec
Q 001655 769 TKGAVYSLNAFNGKLLAAINQ-KIQLYKWMLRDDGTRELQSECGHHGHILALYVQT-RGDFIVVGDLM--KSISLLIYKH 844 (1036)
Q Consensus 769 ~~g~v~~i~~~~g~Lv~~~g~-~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~-~~~~I~vgD~~--~Sv~~~~~~~ 844 (1036)
..+++-.++..+|.|+.|+++ .+.++.....+..+.+|...+.. ...+.+.-.. ..+++..|-.. +-+-+ |+.
T Consensus 104 ~~~~I~gl~~~dg~Litc~~sG~l~~~~~k~~d~hss~l~~la~g-~g~~~~r~~~~~p~Iva~GGke~~n~lki--wdl 180 (412)
T KOG3881|consen 104 GTKSIKGLKLADGTLITCVSSGNLQVRHDKSGDLHSSKLIKLATG-PGLYDVRQTDTDPYIVATGGKENINELKI--WDL 180 (412)
T ss_pred ccccccchhhcCCEEEEEecCCcEEEEeccCCccccccceeeecC-CceeeeccCCCCCceEecCchhcccceee--eec
Confidence 356777788889999888774 56665543222223444433321 1112222111 12333335444 22222 333
Q ss_pred cCCeEEEEecc--------CCcceeEEEEEeeC--c-eEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCcc
Q 001655 845 EEGAIEERARD--------YNANWMSAVEILDD--D-IYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFV 911 (1036)
Q Consensus 845 ~~~~l~~~a~D--------~~~~~~~~~~~l~~--~-~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v 911 (1036)
+..+-+.-|+. ..|.|.+++.|++. . .++.+-+.+.+.+|....+ =.++++|-..+.+
T Consensus 181 e~~~qiw~aKNvpnD~L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~q---------RRPV~~fd~~E~~ 249 (412)
T KOG3881|consen 181 EQSKQIWSAKNVPNDRLGLRVPVWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQ---------RRPVAQFDFLENP 249 (412)
T ss_pred ccceeeeeccCCCCccccceeeeeeccceecCCCCCceEEEEecceeEEEecCccc---------CcceeEeccccCc
Confidence 33333444443 35789999999976 3 4788889999999875431 1355666666554
No 138
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=79.58 E-value=48 Score=30.04 Aligned_cols=66 Identities=24% Similarity=0.290 Sum_probs=49.2
Q ss_pred EeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc-CeEEEE-ECCEEEE
Q 001655 716 GCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN-GKLLAA-INQKIQL 793 (1036)
Q Consensus 716 v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~-g~Lv~~-~g~~l~v 793 (1036)
|.+|+.+-+..++++-|+|||.- .-|.+|+ .=+++++....+.|++++.+. +++.+| .+.+|-+
T Consensus 2 V~al~~~d~d~dg~~eLlvGs~D----------~~IRvf~----~~e~~~Ei~e~~~v~~L~~~~~~~F~Y~l~NGTVGv 67 (111)
T PF14783_consen 2 VTALCLFDFDGDGENELLVGSDD----------FEIRVFK----GDEIVAEITETDKVTSLCSLGGGRFAYALANGTVGV 67 (111)
T ss_pred eeEEEEEecCCCCcceEEEecCC----------cEEEEEe----CCcEEEEEecccceEEEEEcCCCEEEEEecCCEEEE
Confidence 57888888888888999999842 2455563 225688888899999999995 455554 5578889
Q ss_pred EE
Q 001655 794 YK 795 (1036)
Q Consensus 794 ~~ 795 (1036)
|+
T Consensus 68 Y~ 69 (111)
T PF14783_consen 68 YD 69 (111)
T ss_pred Ee
Confidence 87
No 139
>PF14779 BBS1: Ciliary BBSome complex subunit 1
Probab=79.58 E-value=14 Score=38.85 Aligned_cols=77 Identities=12% Similarity=0.222 Sum_probs=52.1
Q ss_pred CceeEEEEcC-CCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEee-eec-CeEEEEEEeCCCcE
Q 001655 477 EYEISCLDIN-PIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLC-AFE-GISYLLCALGDGHL 553 (1036)
Q Consensus 477 ~~~is~l~~~-~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~-~~~-~~~~L~vgl~~G~l 553 (1036)
...|+|++.- ....+......+++||. ++.|.|++-..+.++.+..++ .+|..+... .+. ..-.++|.+|||.+
T Consensus 176 ~t~ITcm~tikk~~~d~~a~scLViGTE-~~~i~iLd~~af~il~~~~lp--svPv~i~~~G~~devdyRI~Va~Rdg~i 252 (257)
T PF14779_consen 176 QTVITCMATIKKSSADEDAVSCLVIGTE-SGEIYILDPQAFTILKQVQLP--SVPVFISVSGQYDEVDYRIVVACRDGKI 252 (257)
T ss_pred CceeEEeeeecccccCCCCcceEEEEec-CCeEEEECchhheeEEEEecC--CCceEEEEEeeeeccceEEEEEeCCCEE
Confidence 3567787531 11111224568899999 999999998888887777776 466666443 232 45669999999988
Q ss_pred EEE
Q 001655 554 LNF 556 (1036)
Q Consensus 554 ~~y 556 (1036)
+..
T Consensus 253 y~i 255 (257)
T PF14779_consen 253 YTI 255 (257)
T ss_pred EEE
Confidence 754
No 140
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=79.24 E-value=1.1e+02 Score=33.86 Aligned_cols=309 Identities=15% Similarity=0.164 Sum_probs=146.7
Q ss_pred CCCcEEEEEeCCC--EEEEEEcCCeEEEEEEcCcE-EEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEE
Q 001655 435 PGYSVNVATANAS--QVLLATGGGHLVYLEIGDGI-LTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIF 511 (1036)
Q Consensus 435 ~~~~I~~as~~~~--~vvv~~~~~~~~~l~~~~~~-l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~ 511 (1036)
.+..|.++...+. .++-...+..+.+-+++... +... ..-..-|.|++.+| .+..++-|+- +|+|.+|
T Consensus 114 H~e~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~--KgH~~WVlcvawsP------Dgk~iASG~~-dg~I~lw 184 (480)
T KOG0271|consen 114 HGEAVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTC--KGHKNWVLCVAWSP------DGKKIASGSK-DGSIRLW 184 (480)
T ss_pred CCCcEEEEEecCCCceEEecCCCceEEeeccCCCCcceee--cCCccEEEEEEECC------Ccchhhcccc-CCeEEEe
Confidence 4457888887643 44433334445554443211 1111 12246789999976 2567888877 9999999
Q ss_pred ECCCCCeeEEecCCCc-cCceeEEeeeec---CeEEEEEEeCCCcEEEEEEecCCCccccceeeecC-ccceEEEEEEeC
Q 001655 512 SLPDLNLITKEHLGGE-IIPRSVLLCAFE---GISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLG-TQPITLRTFSSK 586 (1036)
Q Consensus 512 ~l~~l~~v~~~~l~~~-~~p~si~~~~~~---~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG-~~pv~l~~~~~~ 586 (1036)
+-+.-+.+. ..|+.. --..+++..+++ .--+|--+.+||.+.++........ .. .-| +.||.- +.-
T Consensus 185 dpktg~~~g-~~l~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~~~~----~~-lsgHT~~VTC--vrw- 255 (480)
T KOG0271|consen 185 DPKTGQQIG-RALRGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLGTCV----RT-LSGHTASVTC--VRW- 255 (480)
T ss_pred cCCCCCccc-ccccCcccceeEEeecccccCCCccceecccCCCCEEEEEccCceEE----EE-eccCccceEE--EEE-
Confidence 976544321 112110 011122222221 1124556778999998876532110 00 112 233322 111
Q ss_pred CceEEEEEcCCc--eEEEec-CCcE-----------EEeeeccccceeeecccCC-CC----------------------
Q 001655 587 NTTHVFAASDRP--TVIYSS-NKKL-----------LYSNVNLKEVSHMCPFNSA-AF---------------------- 629 (1036)
Q Consensus 587 ~~~~v~~~~~~p--~~i~~~-~~~~-----------~~~~~~~~~i~~~~~f~~~-~~---------------------- 629 (1036)
|+.+++..|++- .-++.. +|++ .-..++.+-+....+|+.. .+
T Consensus 256 GG~gliySgS~DrtIkvw~a~dG~~~r~lkGHahwvN~lalsTdy~LRtgaf~~t~~~~~~~se~~~~Al~rY~~~~~~~ 335 (480)
T KOG0271|consen 256 GGEGLIYSGSQDRTIKVWRALDGKLCRELKGHAHWVNHLALSTDYVLRTGAFDHTGRKPKSFSEEQKKALERYEAVLKDS 335 (480)
T ss_pred cCCceEEecCCCceEEEEEccchhHHHhhcccchheeeeeccchhhhhccccccccccCCChHHHHHHHHHHHHHhhccC
Confidence 334555555332 222211 1221 0011111111111122211 11
Q ss_pred CCeEEEEeC-CeEEEEEEcCCCCeEEEEEe-CCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE
Q 001655 630 PDSLAIAKE-GELTIGTIDDIQKLHIRSIP-LGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST 707 (1036)
Q Consensus 630 ~~~l~~~~~-~~l~i~~l~~~~~~~~~~i~-l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~ 707 (1036)
++.++..++ ..|.+=+ +...+-++.+.. =..-...+.|+|+.+.++-++.+ .+|+|.|..+++-+.+
T Consensus 336 ~erlVSgsDd~tlflW~-p~~~kkpi~rmtgHq~lVn~V~fSPd~r~IASaSFD----------kSVkLW~g~tGk~las 404 (480)
T KOG0271|consen 336 GERLVSGSDDFTLFLWN-PFKSKKPITRMTGHQALVNHVSFSPDGRYIASASFD----------KSVKLWDGRTGKFLAS 404 (480)
T ss_pred cceeEEecCCceEEEec-ccccccchhhhhchhhheeeEEECCCccEEEEeecc----------cceeeeeCCCcchhhh
Confidence 123555443 3333322 221121222211 12346788999998877777665 4899999999887765
Q ss_pred EECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEE-ecCceeEeccc-cCeEEE
Q 001655 708 YPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKE-TKGAVYSLNAF-NGKLLA 785 (1036)
Q Consensus 708 ~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~-~~g~v~~i~~~-~g~Lv~ 785 (1036)
+. -++-.+-.+.-. ...-++|..+ +--.|.+|++..+|++. ... ....|+++.-- +|..++
T Consensus 405 fR----GHv~~VYqvaws--aDsRLlVS~S---------kDsTLKvw~V~tkKl~~--DLpGh~DEVf~vDwspDG~rV~ 467 (480)
T KOG0271|consen 405 FR----GHVAAVYQVAWS--ADSRLLVSGS---------KDSTLKVWDVRTKKLKQ--DLPGHADEVFAVDWSPDGQRVA 467 (480)
T ss_pred hh----hccceeEEEEec--cCccEEEEcC---------CCceEEEEEeeeeeecc--cCCCCCceEEEEEecCCCceee
Confidence 43 111222222222 1233444443 22478899998766642 111 34467777643 566766
Q ss_pred EECC
Q 001655 786 AINQ 789 (1036)
Q Consensus 786 ~~g~ 789 (1036)
+-|+
T Consensus 468 sggk 471 (480)
T KOG0271|consen 468 SGGK 471 (480)
T ss_pred cCCC
Confidence 6664
No 141
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=78.70 E-value=65 Score=38.32 Aligned_cols=97 Identities=13% Similarity=0.153 Sum_probs=64.6
Q ss_pred EEEeCCeEEEEEEcCCCCeEEEEEe----CCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE
Q 001655 634 AIAKEGELTIGTIDDIQKLHIRSIP----LGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP 709 (1036)
Q Consensus 634 ~~~~~~~l~i~~l~~~~~~~~~~i~----l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~ 709 (1036)
..+.+.+++|..+..... .|.++ =.+++-|+..+|....++-.|+.. .|.++|-.+.|.+.+ -
T Consensus 613 t~cQDrnirif~i~sgKq--~k~FKgs~~~eG~lIKv~lDPSgiY~atScsdk----------tl~~~Df~sgEcvA~-m 679 (1080)
T KOG1408|consen 613 TVCQDRNIRIFDIESGKQ--VKSFKGSRDHEGDLIKVILDPSGIYLATSCSDK----------TLCFVDFVSGECVAQ-M 679 (1080)
T ss_pred EEecccceEEEeccccce--eeeecccccCCCceEEEEECCCccEEEEeecCC----------ceEEEEeccchhhhh-h
Confidence 334578899998886542 12222 235788888888766666666653 788888888887754 4
Q ss_pred CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe
Q 001655 710 LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE 757 (1036)
Q Consensus 710 ~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~ 757 (1036)
+...|.++.++ |..+-+++|-|. .-|-|++|++-
T Consensus 680 ~GHsE~VTG~k---F~nDCkHlISvs-----------gDgCIFvW~lp 713 (1080)
T KOG1408|consen 680 TGHSEAVTGVK---FLNDCKHLISVS-----------GDGCIFVWKLP 713 (1080)
T ss_pred cCcchheeeee---ecccchhheeec-----------CCceEEEEECc
Confidence 56778887764 445556666554 34889999876
No 142
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=78.69 E-value=75 Score=34.23 Aligned_cols=222 Identities=20% Similarity=0.195 Sum_probs=112.9
Q ss_pred EeCCeEEEEEEcCCC------------CeEEEEEeCCCccceE-EE------ecCCCEEEEEEeecCCCCCceeeEEEEE
Q 001655 636 AKEGELTIGTIDDIQ------------KLHIRSIPLGEHPRRI-CH------QEQSRTFAICSLKNQSCAEESEMHFVRL 696 (1036)
Q Consensus 636 ~~~~~l~i~~l~~~~------------~~~~~~i~l~~tp~~i-~y------~~~~~~~~v~~~~~~~~~~~~~~~~l~l 696 (1036)
+.++.|.+-.++... +-..-+++-|+|.--- -| +|+++++++.+-+ .-|++
T Consensus 68 sedn~l~~~nlP~dlys~~~~~~~~~~~~~~~r~~eg~tvydy~wYs~M~s~qP~t~l~a~ssr~----------~PIh~ 137 (406)
T KOG2919|consen 68 SEDNCLNCWNLPFDLYSKKADGPLNFSKHLSYRYQEGETVYDYCWYSRMKSDQPSTNLFAVSSRD----------QPIHL 137 (406)
T ss_pred cccCeeeEEecChhhcccCCCCccccccceeEEeccCCEEEEEEeeeccccCCCccceeeecccc----------Cceee
Confidence 457888888887642 1123344555554222 23 4666665554433 25889
Q ss_pred EeCCCceEEEEEE-CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEe-CC-eEEE---EE--EEE
Q 001655 697 LDDQTFEFISTYP-LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVE-DG-KLQL---IA--EKE 768 (1036)
Q Consensus 697 ~d~~t~~~i~~~~-~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~-~~-kl~~---~~--~~~ 768 (1036)
+|.-|++.-.+|. .+.-++++...++.|..++...++ |- +-.|.+|++. -+ +... +. +..
T Consensus 138 wdaftG~lraSy~~ydh~de~taAhsL~Fs~DGeqlfa-Gy-----------krcirvFdt~RpGr~c~vy~t~~~~k~g 205 (406)
T KOG2919|consen 138 WDAFTGKLRASYRAYDHQDEYTAAHSLQFSPDGEQLFA-GY-----------KRCIRVFDTSRPGRDCPVYTTVTKGKFG 205 (406)
T ss_pred eeccccccccchhhhhhHHhhhhheeEEecCCCCeEee-cc-----------cceEEEeeccCCCCCCcchhhhhccccc
Confidence 9998888887775 455566677777788766554443 42 2367788875 22 2221 11 233
Q ss_pred ecCceeEec--cccC-eEE-EEECCEEEEEEeeecCCCccchhcccccccceEEEEEEE--eCCEEEEEeccccEEEEEE
Q 001655 769 TKGAVYSLN--AFNG-KLL-AAINQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQT--RGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 769 ~~g~v~~i~--~~~g-~Lv-~~~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~--~~~~I~vgD~~~Sv~~~~~ 842 (1036)
+.|.+.+++ +.+. .+. -+-|+.+-+|.+... .-|.....+.. -+++|.. .||++++| ++++-.++.|
T Consensus 206 q~giisc~a~sP~~~~~~a~gsY~q~~giy~~~~~----~pl~llggh~g--GvThL~~~edGn~lfsG-aRk~dkIl~W 278 (406)
T KOG2919|consen 206 QKGIISCFAFSPMDSKTLAVGSYGQRVGIYNDDGR----RPLQLLGGHGG--GVTHLQWCEDGNKLFSG-ARKDDKILCW 278 (406)
T ss_pred ccceeeeeeccCCCCcceeeecccceeeeEecCCC----CceeeecccCC--CeeeEEeccCcCeeccc-ccCCCeEEEE
Confidence 455554443 3344 333 356788889987421 11111111222 2344443 34554443 3333344444
Q ss_pred eccC-----CeEEEEeccCCcceeEEEEEeeCceEE-EEccCCcEEEEeeCC
Q 001655 843 KHEE-----GAIEERARDYNANWMSAVEILDDDIYL-GAENNFNLFTVRKNS 888 (1036)
Q Consensus 843 ~~~~-----~~l~~~a~D~~~~~~~~~~~l~~~~~l-~~D~~gnl~~l~~~~ 888 (1036)
+... .+|...-.|.+.|-..... ..+.+| .+|.+|.+.+++...
T Consensus 279 DiR~~~~pv~~L~rhv~~TNQRI~FDld--~~~~~LasG~tdG~V~vwdlk~ 328 (406)
T KOG2919|consen 279 DIRYSRDPVYALERHVGDTNQRILFDLD--PKGEILASGDTDGSVRVWDLKD 328 (406)
T ss_pred eehhccchhhhhhhhccCccceEEEecC--CCCceeeccCCCccEEEEecCC
Confidence 4321 1122222234444322221 113454 567899999888643
No 143
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=78.46 E-value=39 Score=40.70 Aligned_cols=119 Identities=11% Similarity=0.146 Sum_probs=75.8
Q ss_pred EEEeCC-CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEE
Q 001655 655 RSIPLG-EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYC 733 (1036)
Q Consensus 655 ~~i~l~-~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~ 733 (1036)
-++..+ ..|..+.-+. .+.++++-. .++.+.+.|.+.........|+.++.+..+ .|....++...++
T Consensus 23 ~~~~T~i~~~~li~gss-~~k~a~V~~---------~~~~LtIWD~~~~~lE~~~~f~~~~~I~dL-DWtst~d~qsiLa 91 (631)
T PF12234_consen 23 STFETGISNPSLISGSS-IKKIAVVDS---------SRSELTIWDTRSGVLEYEESFSEDDPIRDL-DWTSTPDGQSILA 91 (631)
T ss_pred EEEecCCCCcceEeecc-cCcEEEEEC---------CCCEEEEEEcCCcEEEEeeeecCCCceeec-eeeecCCCCEEEE
Confidence 344444 3566666555 444555532 246889999877776677778888888776 4666667788999
Q ss_pred EEeeeeCCCCCCCcceEEEEEEEe-----CC-----eEEEEEEEE-ecCceeEeccc-cCeEEEEECCEEEEEE
Q 001655 734 VGTAYVLPEENEPTKGRILVFIVE-----DG-----KLQLIAEKE-TKGAVYSLNAF-NGKLLAAINQKIQLYK 795 (1036)
Q Consensus 734 VGT~~~~~~e~~~~~Gri~v~~i~-----~~-----kl~~~~~~~-~~g~v~~i~~~-~g~Lv~~~g~~l~v~~ 795 (1036)
||-.. ++.+|.-- +. .++.+.-.+ ++.|+.+.+=. +|.|++|.|+++++|+
T Consensus 92 VGf~~-----------~v~l~~Q~R~dy~~~~p~w~~i~~i~i~~~T~h~Igds~Wl~~G~LvV~sGNqlfv~d 154 (631)
T PF12234_consen 92 VGFPH-----------HVLLYTQLRYDYTNKGPSWAPIRKIDISSHTPHPIGDSIWLKDGTLVVGSGNQLFVFD 154 (631)
T ss_pred EEcCc-----------EEEEEEccchhhhcCCcccceeEEEEeecCCCCCccceeEecCCeEEEEeCCEEEEEC
Confidence 99642 44444321 11 233333223 34677766655 6799999999999986
No 144
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=78.14 E-value=31 Score=38.20 Aligned_cols=98 Identities=17% Similarity=0.146 Sum_probs=58.8
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEe---ccCCceeEEEEcCCC
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKH---AQLEYEISCLDINPI 488 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~---~~l~~~is~l~~~~~ 488 (1036)
.+.||+++..+..+..+ .|.|..|++.+.+ +..++.+..++.+-.+.+...++...-+ +......+..-++|
T Consensus 321 DkkvRfwD~Rs~~~~~s--v~~gg~vtSl~ls~~g~~lLsssRDdtl~viDlRt~eI~~~~sA~g~k~asDwtrvvfSp- 397 (459)
T KOG0288|consen 321 DKKVRFWDIRSADKTRS--VPLGGRVTSLDLSMDGLELLSSSRDDTLKVIDLRTKEIRQTFSAEGFKCASDWTRVVFSP- 397 (459)
T ss_pred ccceEEEeccCCceeeE--eecCcceeeEeeccCCeEEeeecCCCceeeeecccccEEEEeeccccccccccceeEECC-
Confidence 45588887655444444 3456688888865 4455555556666555543323332211 22234455555554
Q ss_pred CCCCCcccEEEEEEecCCEEEEEECCCCCeeE
Q 001655 489 GENPSYSQIAAVGMWTDISVRIFSLPDLNLIT 520 (1036)
Q Consensus 489 ~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~ 520 (1036)
.+.|++.|.- ||+++||++.+-++..
T Consensus 398 -----d~~YvaAGS~-dgsv~iW~v~tgKlE~ 423 (459)
T KOG0288|consen 398 -----DGSYVAAGSA-DGSVYIWSVFTGKLEK 423 (459)
T ss_pred -----CCceeeeccC-CCcEEEEEccCceEEE
Confidence 3679999988 9999999998755433
No 145
>PHA02713 hypothetical protein; Provisional
Probab=78.12 E-value=77 Score=38.25 Aligned_cols=138 Identities=16% Similarity=0.169 Sum_probs=73.2
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECC-------EEEEEEeeecCC
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQ-------KIQLYKWMLRDD 801 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~-------~l~v~~~~~~~~ 801 (1036)
...+++|.... .......+..|+...++...+......-.=.+++.++|+|++.-|. .+..|+. ..
T Consensus 304 ~~IYviGG~~~----~~~~~~~v~~Yd~~~n~W~~~~~m~~~R~~~~~~~~~g~IYviGG~~~~~~~~sve~Ydp--~~- 376 (557)
T PHA02713 304 NEIIIAGGYNF----NNPSLNKVYKINIENKIHVELPPMIKNRCRFSLAVIDDTIYAIGGQNGTNVERTIECYTM--GD- 376 (557)
T ss_pred CEEEEEcCCCC----CCCccceEEEEECCCCeEeeCCCCcchhhceeEEEECCEEEEECCcCCCCCCceEEEEEC--CC-
Confidence 46777775311 1122356778887776666555433322223556667777665442 3555553 22
Q ss_pred CccchhcccccccceEEEEEEEeCCEEEE-Eeccc---------------------cEEEEEEeccCCeEEEEeccCCcc
Q 001655 802 GTRELQSECGHHGHILALYVQTRGDFIVV-GDLMK---------------------SISLLIYKHEEGAIEERARDYNAN 859 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~~---------------------Sv~~~~~~~~~~~l~~~a~D~~~~ 859 (1036)
. ++...+.+..+.....+.+.+++|+| |-... .-.+..|+++.++...++.=+.+|
T Consensus 377 ~--~W~~~~~mp~~r~~~~~~~~~g~IYviGG~~~~~~~~~~~~~~~~~~~~~~~~~~~ve~YDP~td~W~~v~~m~~~r 454 (557)
T PHA02713 377 D--KWKMLPDMPIALSSYGMCVLDQYIYIIGGRTEHIDYTSVHHMNSIDMEEDTHSSNKVIRYDTVNNIWETLPNFWTGT 454 (557)
T ss_pred C--eEEECCCCCcccccccEEEECCEEEEEeCCCcccccccccccccccccccccccceEEEECCCCCeEeecCCCCccc
Confidence 2 23333322222222234456777776 43211 123678999999998888655666
Q ss_pred eeEEEEEeeCceEEEE
Q 001655 860 WMSAVEILDDDIYLGA 875 (1036)
Q Consensus 860 ~~~~~~~l~~~~~l~~ 875 (1036)
.-.++..+++.-++.+
T Consensus 455 ~~~~~~~~~~~IYv~G 470 (557)
T PHA02713 455 IRPGVVSHKDDIYVVC 470 (557)
T ss_pred ccCcEEEECCEEEEEe
Confidence 5555556664444443
No 146
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=77.82 E-value=99 Score=32.70 Aligned_cols=134 Identities=13% Similarity=0.111 Sum_probs=79.5
Q ss_pred CcEEEEecCCccceeeeeCCCCCcEEEEEeCCC--EEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCC
Q 001655 415 GSVRLVSSTSRELRNEWKSPPGYSVNVATANAS--QVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENP 492 (1036)
Q Consensus 415 ~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~--~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~ 492 (1036)
+.+++.+....+..+. .+....-+..++++++ .+.-.-.++++.+-++++++- ....+-...|.+++++|
T Consensus 172 ktvKvWnl~~~~l~~~-~~gh~~~v~t~~vSpDGslcasGgkdg~~~LwdL~~~k~--lysl~a~~~v~sl~fsp----- 243 (315)
T KOG0279|consen 172 KTVKVWNLRNCQLRTT-FIGHSGYVNTVTVSPDGSLCASGGKDGEAMLWDLNEGKN--LYSLEAFDIVNSLCFSP----- 243 (315)
T ss_pred ceEEEEccCCcchhhc-cccccccEEEEEECCCCCEEecCCCCceEEEEEccCCce--eEeccCCCeEeeEEecC-----
Confidence 4566776665333222 2223334666666643 333223457777777766432 22234445678888876
Q ss_pred CcccEEEEEEecCCEEEEEECCCCCeeEEecCC------CccCceeEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 493 SYSQIAAVGMWTDISVRIFSLPDLNLITKEHLG------GEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 493 ~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~------~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
....++.++ +.+|.||++..-..+....+. ....|+++.++-..+..+||.|..||.+..+++.
T Consensus 244 -nrywL~~at--~~sIkIwdl~~~~~v~~l~~d~~g~s~~~~~~~clslaws~dG~tLf~g~td~~irv~qv~ 313 (315)
T KOG0279|consen 244 -NRYWLCAAT--ATSIKIWDLESKAVVEELKLDGIGPSSKAGDPICLSLAWSADGQTLFAGYTDNVIRVWQVA 313 (315)
T ss_pred -CceeEeecc--CCceEEEeccchhhhhhccccccccccccCCcEEEEEEEcCCCcEEEeeecCCcEEEEEee
Confidence 244555554 456999998764443321111 0135777777766778999999999999988864
No 147
>PHA03098 kelch-like protein; Provisional
Probab=77.69 E-value=60 Score=39.04 Aligned_cols=132 Identities=10% Similarity=0.014 Sum_probs=69.1
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEEC--------CEEEEEEeeecC
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAIN--------QKIQLYKWMLRD 800 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g--------~~l~v~~~~~~~ 800 (1036)
...+++|... .......+..|+...++.+.+.....+-.-.+.+.++|+|++.-| +.+..|+. .+
T Consensus 343 ~~lyv~GG~~-----~~~~~~~v~~yd~~~~~W~~~~~lp~~r~~~~~~~~~~~iYv~GG~~~~~~~~~~v~~yd~--~t 415 (534)
T PHA03098 343 NRIYVIGGIY-----NSISLNTVESWKPGESKWREEPPLIFPRYNPCVVNVNNLIYVIGGISKNDELLKTVECFSL--NT 415 (534)
T ss_pred CEEEEEeCCC-----CCEecceEEEEcCCCCceeeCCCcCcCCccceEEEECCEEEEECCcCCCCcccceEEEEeC--CC
Confidence 5677888642 112345677777776677655543333223344556888877655 23555553 21
Q ss_pred CCccchhcccccccceEEEEEEEeCCEEEE-Eeccc------cEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCc
Q 001655 801 DGTRELQSECGHHGHILALYVQTRGDFIVV-GDLMK------SISLLIYKHEEGAIEERARDYNANWMSAVEILDDD 870 (1036)
Q Consensus 801 ~~~~~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~~------Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~ 870 (1036)
+. +...+.........+..+.++.|++ |-... --.+..|+++.++...++.-+.+++-.++..+++.
T Consensus 416 -~~--W~~~~~~p~~r~~~~~~~~~~~iyv~GG~~~~~~~~~~~~v~~yd~~~~~W~~~~~~~~~r~~~~~~~~~~~ 489 (534)
T PHA03098 416 -NK--WSKGSPLPISHYGGCAIYHDGKIYVIGGISYIDNIKVYNIVESYNPVTNKWTELSSLNFPRINASLCIFNNK 489 (534)
T ss_pred -Ce--eeecCCCCccccCceEEEECCEEEEECCccCCCCCcccceEEEecCCCCceeeCCCCCcccccceEEEECCE
Confidence 22 3222211111122234556776665 32110 01267889888888888766666665555555433
No 148
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=77.10 E-value=82 Score=34.69 Aligned_cols=136 Identities=10% Similarity=0.086 Sum_probs=81.5
Q ss_pred CeEEEEEEcCCCCeEEEEEeCCC---ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCe
Q 001655 639 GELTIGTIDDIQKLHIRSIPLGE---HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEY 715 (1036)
Q Consensus 639 ~~l~i~~l~~~~~~~~~~i~l~~---tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~ 715 (1036)
+++++.+..+ ..|.+...|+-. ...-+.++|..+.+...|+- -.+|++.|-.+..--...-.+.++.
T Consensus 234 ~~I~lw~~~~-g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~---------DgsIrIWDiRs~~~~~~~~~kAh~s 303 (440)
T KOG0302|consen 234 KGIHLWEPST-GSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSC---------DGSIRIWDIRSGPKKAAVSTKAHNS 303 (440)
T ss_pred cceEeeeecc-CceeecCccccccccchhhhccCCccCceEEeeec---------CceEEEEEecCCCccceeEeeccCC
Confidence 3455555554 678777777743 45557788866655555542 1588888865552222222244443
Q ss_pred EeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEE-EEEEE-EecCceeEeccc--cCeEEEEEC--C
Q 001655 716 GCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQ-LIAEK-ETKGAVYSLNAF--NGKLLAAIN--Q 789 (1036)
Q Consensus 716 v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~-~~~~~-~~~g~v~~i~~~--~g~Lv~~~g--~ 789 (1036)
=.-+.+| + ....+|+-|. -.|.+.++++..-|.. .++.. -+++||++|.=- ....+++.| +
T Consensus 304 DVNVISW--n-r~~~lLasG~----------DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e~s~iaasg~D~ 370 (440)
T KOG0302|consen 304 DVNVISW--N-RREPLLASGG----------DDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHEDSVIAASGEDN 370 (440)
T ss_pred ceeeEEc--c-CCcceeeecC----------CCceEEEEEhhhccCCCcceeEEeccCCeeEEEeccccCceEEeccCCC
Confidence 2233344 2 2345777664 4589999999855443 45544 468999999733 456666655 6
Q ss_pred EEEEEEee
Q 001655 790 KIQLYKWM 797 (1036)
Q Consensus 790 ~l~v~~~~ 797 (1036)
+|.++++.
T Consensus 371 QitiWDls 378 (440)
T KOG0302|consen 371 QITIWDLS 378 (440)
T ss_pred cEEEEEee
Confidence 88888775
No 149
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=76.95 E-value=1.4e+02 Score=33.95 Aligned_cols=244 Identities=19% Similarity=0.262 Sum_probs=128.6
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCe-eEEecCCCccCceeEEeeee-cCeEEEEEEeCCCcEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNL-ITKEHLGGEIIPRSVLLCAF-EGISYLLCALGDGHLL 554 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~-v~~~~l~~~~~p~si~~~~~-~~~~~L~vgl~~G~l~ 554 (1036)
..+|+||+-+. .+..++.|.. +|.++||+.+.-.+ ...++-. +.-++ +. ....||+-|..||..+
T Consensus 235 nkdVT~L~Wn~------~G~~LatG~~-~G~~riw~~~G~l~~tl~~Hkg---PI~sl---KWnk~G~yilS~~vD~tti 301 (524)
T KOG0273|consen 235 NKDVTSLDWNN------DGTLLATGSE-DGEARIWNKDGNLISTLGQHKG---PIFSL---KWNKKGTYILSGGVDGTTI 301 (524)
T ss_pred cCCcceEEecC------CCCeEEEeec-CcEEEEEecCchhhhhhhccCC---ceEEE---EEcCCCCEEEeccCCccEE
Confidence 46789998853 3679999999 99999999876222 1112221 11222 33 2568999999999998
Q ss_pred EEEEecCCCccccceeeecCccc-eEEEEEEeCCceEEEEEcCCc--eEEEe-c--CCcEEEeeeccccceeeecccCCC
Q 001655 555 NFLLNMKTGELTDRKKVSLGTQP-ITLRTFSSKNTTHVFAASDRP--TVIYS-S--NKKLLYSNVNLKEVSHMCPFNSAA 628 (1036)
Q Consensus 555 ~y~~~~~~~~l~~~~~~~lG~~p-v~l~~~~~~~~~~v~~~~~~p--~~i~~-~--~~~~~~~~~~~~~i~~~~~f~~~~ 628 (1036)
.+..... ..+.+ ..+-..| +.+- . . .+.-|++++.- ..++. . .+.-.+.. +..+|.+ ..|+
T Consensus 302 lwd~~~g--~~~q~--f~~~s~~~lDVd-W-~--~~~~F~ts~td~~i~V~kv~~~~P~~t~~G-H~g~V~a-lk~n--- 368 (524)
T KOG0273|consen 302 LWDAHTG--TVKQQ--FEFHSAPALDVD-W-Q--SNDEFATSSTDGCIHVCKVGEDRPVKTFIG-HHGEVNA-LKWN--- 368 (524)
T ss_pred EEeccCc--eEEEe--eeeccCCccceE-E-e--cCceEeecCCCceEEEEEecCCCcceeeec-ccCceEE-EEEC---
Confidence 8775432 21111 1111222 1000 0 0 11223333222 11221 1 11111221 2122222 1222
Q ss_pred CCCe-EEE-E-eCCeEEEEEEcCCCC-----------eEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEE
Q 001655 629 FPDS-LAI-A-KEGELTIGTIDDIQK-----------LHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFV 694 (1036)
Q Consensus 629 ~~~~-l~~-~-~~~~l~i~~l~~~~~-----------~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l 694 (1036)
|.+ |+. + +++.|+|=.+..... +.++-.|.+ .+.-.|..+...+.++. .+.|
T Consensus 369 -~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~~Hskei~t~~wsp~g----~v~~n~~~~~~l~sas~---------dstV 434 (524)
T KOG0273|consen 369 -PTGSLLASCSDDGTLKIWSMGQSNSVHDLQAHSKEIYTIKWSPTG----PVTSNPNMNLMLASASF---------DSTV 434 (524)
T ss_pred -CCCceEEEecCCCeeEeeecCCCcchhhhhhhccceeeEeecCCC----CccCCCcCCceEEEeec---------CCeE
Confidence 222 332 2 478898888765431 223333433 23345555655555553 2799
Q ss_pred EEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCcee
Q 001655 695 RLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVY 774 (1036)
Q Consensus 695 ~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~ 774 (1036)
++.|......+..+ ++..|-|++++. . .+..|++-|. ..|++.++.+.-+++ +++..-.|.|.
T Consensus 435 ~lwdv~~gv~i~~f-~kH~~pVysvaf---S-~~g~ylAsGs----------~dg~V~iws~~~~~l--~~s~~~~~~If 497 (524)
T KOG0273|consen 435 KLWDVESGVPIHTL-MKHQEPVYSVAF---S-PNGRYLASGS----------LDGCVHIWSTKTGKL--VKSYQGTGGIF 497 (524)
T ss_pred EEEEccCCceeEee-ccCCCceEEEEe---c-CCCcEEEecC----------CCCeeEeccccchhe--eEeecCCCeEE
Confidence 99999888777652 255677776643 2 3467888775 568999997754443 44444455555
Q ss_pred Eec
Q 001655 775 SLN 777 (1036)
Q Consensus 775 ~i~ 777 (1036)
.+|
T Consensus 498 el~ 500 (524)
T KOG0273|consen 498 ELC 500 (524)
T ss_pred EEE
Confidence 555
No 150
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=76.62 E-value=1.1e+02 Score=32.46 Aligned_cols=154 Identities=15% Similarity=0.188 Sum_probs=91.6
Q ss_pred cceEEEecCC-CEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCC
Q 001655 663 PRRICHQEQS-RTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLP 741 (1036)
Q Consensus 663 p~~i~y~~~~-~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~ 741 (1036)
...+.++|.. +-++|-++ +-..|++.|..+++....|.=.. -. +..+.+..++. ..+-|
T Consensus 151 VscvrfsP~~~~p~Ivs~s---------~DktvKvWnl~~~~l~~~~~gh~-~~---v~t~~vSpDGs-lcasG------ 210 (315)
T KOG0279|consen 151 VSCVRFSPNESNPIIVSAS---------WDKTVKVWNLRNCQLRTTFIGHS-GY---VNTVTVSPDGS-LCASG------ 210 (315)
T ss_pred EEEEEEcCCCCCcEEEEcc---------CCceEEEEccCCcchhhcccccc-cc---EEEEEECCCCC-EEecC------
Confidence 4566777765 44444444 22578888888777655443221 11 22333433322 22222
Q ss_pred CCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCe--EEEEECCEEEEEEeeecCC-Cccchh--cccccccce
Q 001655 742 EENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGK--LLAAINQKIQLYKWMLRDD-GTRELQ--SECGHHGHI 816 (1036)
Q Consensus 742 ~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~--Lv~~~g~~l~v~~~~~~~~-~~~~L~--~~~~~~~~~ 816 (1036)
+ +.|.++++++..+|- ++..+...+|.+++--.++ |.+|.+..|.+++++.+.. .+.++. ........+
T Consensus 211 g----kdg~~~LwdL~~~k~--lysl~a~~~v~sl~fspnrywL~~at~~sIkIwdl~~~~~v~~l~~d~~g~s~~~~~~ 284 (315)
T KOG0279|consen 211 G----KDGEAMLWDLNEGKN--LYSLEAFDIVNSLCFSPNRYWLCAATATSIKIWDLESKAVVEELKLDGIGPSSKAGDP 284 (315)
T ss_pred C----CCceEEEEEccCCce--eEeccCCCeEeeEEecCCceeEeeccCCceEEEeccchhhhhhccccccccccccCCc
Confidence 2 568999999986665 7788889999999977664 6678889999988742210 011111 111111234
Q ss_pred EEEEEEEe--CCEEEEEeccccEEEEEE
Q 001655 817 LALYVQTR--GDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 817 ~~~~l~~~--~~~I~vgD~~~Sv~~~~~ 842 (1036)
.++++.+. |..++.|+--..+-+.+.
T Consensus 285 ~clslaws~dG~tLf~g~td~~irv~qv 312 (315)
T KOG0279|consen 285 ICLSLAWSADGQTLFAGYTDNVIRVWQV 312 (315)
T ss_pred EEEEEEEcCCCcEEEeeecCCcEEEEEe
Confidence 56677665 778899988888766543
No 151
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=75.96 E-value=67 Score=34.07 Aligned_cols=155 Identities=14% Similarity=0.100 Sum_probs=95.0
Q ss_pred EEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC--eEEEEEEEEecCceeEecccc------CeEEEEECCEEE
Q 001655 721 SCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG--KLQLIAEKETKGAVYSLNAFN------GKLLAAINQKIQ 792 (1036)
Q Consensus 721 ~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~--kl~~~~~~~~~g~v~~i~~~~------g~Lv~~~g~~l~ 792 (1036)
.|....+.+..++||+-.. ...-+|-+...+.. .+.....++++-|++.+--+- -.|++..|..++
T Consensus 51 ~Ws~~~~~~~rla~gS~~E------e~~Nkvqiv~ld~~s~e~~~~a~fd~~YP~tK~~wiPd~~g~~pdlLATs~D~LR 124 (364)
T KOG0290|consen 51 NWSVRPDKKFRLAVGSFIE------EYNNKVQIVQLDEDSGELVEDANFDHPYPVTKLMWIPDSKGVYPDLLATSSDFLR 124 (364)
T ss_pred ccccCCCcceeEEEeeecc------ccCCeeEEEEEccCCCceeccCCCCCCCCccceEecCCccccCcchhhcccCeEE
Confidence 3544456688999998642 24567777777744 444444568888999886442 248999999999
Q ss_pred EEEeeecCCCccchhc------ccccccceEEEEEEE---eCCEEEEEeccccEEEEEEecc-C--CeEEEEeccCCcce
Q 001655 793 LYKWMLRDDGTRELQS------ECGHHGHILALYVQT---RGDFIVVGDLMKSISLLIYKHE-E--GAIEERARDYNANW 860 (1036)
Q Consensus 793 v~~~~~~~~~~~~L~~------~~~~~~~~~~~~l~~---~~~~I~vgD~~~Sv~~~~~~~~-~--~~l~~~a~D~~~~~ 860 (1036)
+++..+. +...++.. ...+.. ..++.++ .-++|.+.-+-.-.++...... . -+-.++|.|. .
T Consensus 125 lWri~~e-e~~~~~~~~L~~~kns~~~a--PlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQLIAHDK---E 198 (364)
T KOG0290|consen 125 LWRIGDE-ESRVELQSVLNNNKNSEFCA--PLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQLIAHDK---E 198 (364)
T ss_pred EEeccCc-CCceehhhhhccCcccccCC--cccccccccCCcceeEeecccCeEEEEEEeeccccceeeEEEecCc---c
Confidence 9987532 22222211 111111 2344443 3467777777776666543332 1 1456777764 4
Q ss_pred eEEEEEeeC--ceEEEEccCCcEEEEeeC
Q 001655 861 MSAVEILDD--DIYLGAENNFNLFTVRKN 887 (1036)
Q Consensus 861 ~~~~~~l~~--~~~l~~D~~gnl~~l~~~ 887 (1036)
|..+.|+.. +.|...-.+|.+.+|...
T Consensus 199 V~DIaf~~~s~~~FASvgaDGSvRmFDLR 227 (364)
T KOG0290|consen 199 VYDIAFLKGSRDVFASVGADGSVRMFDLR 227 (364)
T ss_pred eeEEEeccCccceEEEecCCCcEEEEEec
Confidence 777888864 346666678999988764
No 152
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=75.95 E-value=1.3e+02 Score=33.07 Aligned_cols=73 Identities=21% Similarity=0.189 Sum_probs=42.2
Q ss_pred CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEE
Q 001655 477 EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNF 556 (1036)
Q Consensus 477 ~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y 556 (1036)
+..+-|+...+... .-..+++|.- +|+|.||++....+-+..... ..+.=+.+....||+.+..||.+..+
T Consensus 283 e~~~esve~~~~ss---~lpL~A~G~v-dG~i~iyD~a~~~~R~~c~he-----~~V~~l~w~~t~~l~t~c~~g~v~~w 353 (399)
T KOG0296|consen 283 EELDESVESIPSSS---KLPLAACGSV-DGTIAIYDLAASTLRHICEHE-----DGVTKLKWLNTDYLLTACANGKVRQW 353 (399)
T ss_pred hhhhhhhhhccccc---ccchhhcccc-cceEEEEecccchhheeccCC-----CceEEEEEcCcchheeeccCceEEee
Confidence 34445664433221 2345677766 999999998765443221111 12211233347899999999977665
Q ss_pred EE
Q 001655 557 LL 558 (1036)
Q Consensus 557 ~~ 558 (1036)
..
T Consensus 354 Da 355 (399)
T KOG0296|consen 354 DA 355 (399)
T ss_pred ec
Confidence 43
No 153
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=74.42 E-value=1e+02 Score=31.23 Aligned_cols=94 Identities=18% Similarity=0.101 Sum_probs=57.9
Q ss_pred EEEEEeCC--CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCce
Q 001655 653 HIRSIPLG--EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNV 730 (1036)
Q Consensus 653 ~~~~i~l~--~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~ 730 (1036)
++..+.+. +..+.++++|..+.|+|+.... ...+.|+|.+ .+.+.. |+.. ...++ .| .. ..+
T Consensus 50 ~~~~i~l~~~~~I~~~~WsP~g~~favi~g~~--------~~~v~lyd~~-~~~i~~--~~~~-~~n~i-~w--sP-~G~ 113 (194)
T PF08662_consen 50 PVESIELKKEGPIHDVAWSPNGNEFAVIYGSM--------PAKVTLYDVK-GKKIFS--FGTQ-PRNTI-SW--SP-DGR 113 (194)
T ss_pred ccceeeccCCCceEEEEECcCCCEEEEEEccC--------CcccEEEcCc-ccEeEe--ecCC-CceEE-EE--CC-CCC
Confidence 45666664 3578999999999999886421 2378999985 444443 3332 23332 23 32 356
Q ss_pred EEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecC
Q 001655 731 YYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKG 771 (1036)
Q Consensus 731 ~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g 771 (1036)
++++|..- ...|.+.+|++.+ .+.+...+..+
T Consensus 114 ~l~~~g~~-------n~~G~l~~wd~~~--~~~i~~~~~~~ 145 (194)
T PF08662_consen 114 FLVLAGFG-------NLNGDLEFWDVRK--KKKISTFEHSD 145 (194)
T ss_pred EEEEEEcc-------CCCcEEEEEECCC--CEEeeccccCc
Confidence 77776531 2459999999874 44455555544
No 154
>PF08450 SGL: SMP-30/Gluconolaconase/LRE-like region; InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=74.22 E-value=1.2e+02 Score=31.91 Aligned_cols=210 Identities=15% Similarity=0.079 Sum_probs=102.0
Q ss_pred eEEEEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 632 SLAIAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 632 ~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
.|++++-..=.|.+++.... ..+.+.+.. |.-++.+...+.++++... .+.++|+.+.+...-.+..
T Consensus 13 ~l~~~D~~~~~i~~~~~~~~-~~~~~~~~~-~~G~~~~~~~g~l~v~~~~-----------~~~~~d~~~g~~~~~~~~~ 79 (246)
T PF08450_consen 13 RLYWVDIPGGRIYRVDPDTG-EVEVIDLPG-PNGMAFDRPDGRLYVADSG-----------GIAVVDPDTGKVTVLADLP 79 (246)
T ss_dssp EEEEEETTTTEEEEEETTTT-EEEEEESSS-EEEEEEECTTSEEEEEETT-----------CEEEEETTTTEEEEEEEEE
T ss_pred EEEEEEcCCCEEEEEECCCC-eEEEEecCC-CceEEEEccCCEEEEEEcC-----------ceEEEecCCCcEEEEeecc
Confidence 34444422223444444333 234466666 7778888333666665432 3566688777655444432
Q ss_pred CCC-eEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cC-eEEEEE-
Q 001655 712 TFE-YGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NG-KLLAAI- 787 (1036)
Q Consensus 712 ~~E-~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g-~Lv~~~- 787 (1036)
.+. .....--+.+..+++ +.+++..... ......|+++.++.. ++.+.+... + ..+..|+-- ++ .|+++-
T Consensus 80 ~~~~~~~~~ND~~vd~~G~--ly~t~~~~~~-~~~~~~g~v~~~~~~-~~~~~~~~~-~-~~pNGi~~s~dg~~lyv~ds 153 (246)
T PF08450_consen 80 DGGVPFNRPNDVAVDPDGN--LYVTDSGGGG-ASGIDPGSVYRIDPD-GKVTVVADG-L-GFPNGIAFSPDGKTLYVADS 153 (246)
T ss_dssp TTCSCTEEEEEEEE-TTS---EEEEEECCBC-TTCGGSEEEEEEETT-SEEEEEEEE-E-SSEEEEEEETTSSEEEEEET
T ss_pred CCCcccCCCceEEEcCCCC--EEEEecCCCc-cccccccceEEECCC-CeEEEEecC-c-ccccceEECCcchheeeccc
Confidence 122 222333334444333 5566654321 111112999888776 677666543 2 233444422 34 566553
Q ss_pred -CCEEEEEEeeecCCCccchhc---cccccc---ceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcce
Q 001655 788 -NQKIQLYKWMLRDDGTRELQS---ECGHHG---HILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANW 860 (1036)
Q Consensus 788 -g~~l~v~~~~~~~~~~~~L~~---~~~~~~---~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~ 860 (1036)
+++|+.|.++.. + .++.. ...... .+-.+.++..| .|+|++...+- +.+|+++...+..+. -+.+ .
T Consensus 154 ~~~~i~~~~~~~~--~-~~~~~~~~~~~~~~~~g~pDG~~vD~~G-~l~va~~~~~~-I~~~~p~G~~~~~i~-~p~~-~ 226 (246)
T PF08450_consen 154 FNGRIWRFDLDAD--G-GELSNRRVFIDFPGGPGYPDGLAVDSDG-NLWVADWGGGR-IVVFDPDGKLLREIE-LPVP-R 226 (246)
T ss_dssp TTTEEEEEEEETT--T-CCEEEEEEEEE-SSSSCEEEEEEEBTTS--EEEEEETTTE-EEEEETTSCEEEEEE--SSS-S
T ss_pred ccceeEEEecccc--c-cceeeeeeEEEcCCCCcCCCcceEcCCC-CEEEEEcCCCE-EEEECCCccEEEEEc-CCCC-C
Confidence 466776666421 1 11211 011111 12233444444 58888876663 567898844444444 3433 6
Q ss_pred eEEEEEe
Q 001655 861 MSAVEIL 867 (1036)
Q Consensus 861 ~~~~~~l 867 (1036)
++++.|=
T Consensus 227 ~t~~~fg 233 (246)
T PF08450_consen 227 PTNCAFG 233 (246)
T ss_dssp EEEEEEE
T ss_pred EEEEEEE
Confidence 7777774
No 155
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=74.20 E-value=1.5e+02 Score=32.85 Aligned_cols=68 Identities=21% Similarity=0.163 Sum_probs=42.7
Q ss_pred ccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeec-CeEEEEEEeCCCcEEEEEEecCCCcc
Q 001655 495 SQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFE-GISYLLCALGDGHLLNFLLNMKTGEL 565 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~-~~~~L~vgl~~G~l~~y~~~~~~~~l 565 (1036)
+.+++-|++ ||.+++|++..-...... .......++.-...+ ....++.+..|-.+.-|+++.....+
T Consensus 115 ~~~IltgsY-Dg~~riWd~~Gk~~~~~~--Ght~~ik~v~~v~~n~~~~~fvsas~Dqtl~Lw~~~~~~~~~ 183 (423)
T KOG0313|consen 115 SKWILTGSY-DGTSRIWDLKGKSIKTIV--GHTGPIKSVAWVIKNSSSCLFVSASMDQTLRLWKWNVGENKV 183 (423)
T ss_pred CceEEEeec-CCeeEEEecCCceEEEEe--cCCcceeeeEEEecCCccceEEEecCCceEEEEEecCchhhh
Confidence 789999999 999999999864332111 111233344333222 23346667788899999998765433
No 156
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=74.16 E-value=49 Score=38.92 Aligned_cols=177 Identities=12% Similarity=0.181 Sum_probs=90.3
Q ss_pred EEEEEEeCCCceEEEEEEC-CCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCe------EEEE
Q 001655 692 HFVRLLDDQTFEFISTYPL-DTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGK------LQLI 764 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~-~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~k------l~~~ 764 (1036)
.+|++.++......+.-.+ ....+|.|+... .+...+++..+. -++|++|++.-+- ...+
T Consensus 95 tTVK~W~~~~~~~~c~stir~H~DYVkcla~~----ak~~~lvaSgGL---------D~~IflWDin~~~~~l~~s~n~~ 161 (735)
T KOG0308|consen 95 TTVKVWNAHKDNTFCMSTIRTHKDYVKCLAYI----AKNNELVASGGL---------DRKIFLWDINTGTATLVASFNNV 161 (735)
T ss_pred ceEEEeecccCcchhHhhhhcccchheeeeec----ccCceeEEecCC---------CccEEEEEccCcchhhhhhcccc
Confidence 4677777643321110011 223556666553 123344443332 3689999997331 1112
Q ss_pred EEE----EecCceeEecccc-CeEEEEEC--CEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccE
Q 001655 765 AEK----ETKGAVYSLNAFN-GKLLAAIN--QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSI 837 (1036)
Q Consensus 765 ~~~----~~~g~v~~i~~~~-g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv 837 (1036)
... -.+.+||+++.-+ |.++++-| +.|++|+ .+ ..+|+++...+...+-++-+.-.|++++-|-.---+
T Consensus 162 t~~sl~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wD--pr--t~~kimkLrGHTdNVr~ll~~dDGt~~ls~sSDgtI 237 (735)
T KOG0308|consen 162 TVNSLGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWD--PR--TCKKIMKLRGHTDNVRVLLVNDDGTRLLSASSDGTI 237 (735)
T ss_pred ccccCCCCCccceeeeecCCcceEEEecCcccceEEec--cc--cccceeeeeccccceEEEEEcCCCCeEeecCCCceE
Confidence 222 2345788888664 56777665 3466655 33 234444443344444445555567787776655555
Q ss_pred EEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeC
Q 001655 838 SLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKN 887 (1036)
Q Consensus 838 ~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~ 887 (1036)
-+.....+.-.....+ .....|...+. -+-..+..+|++||+..-...
T Consensus 238 rlWdLgqQrCl~T~~v-H~e~VWaL~~~-~sf~~vYsG~rd~~i~~Tdl~ 285 (735)
T KOG0308|consen 238 RLWDLGQQRCLATYIV-HKEGVWALQSS-PSFTHVYSGGRDGNIYRTDLR 285 (735)
T ss_pred EeeeccccceeeeEEe-ccCceEEEeeC-CCcceEEecCCCCcEEecccC
Confidence 5543333222222222 22236655443 111357899999999886654
No 157
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=73.80 E-value=1.9e+02 Score=33.86 Aligned_cols=196 Identities=12% Similarity=0.063 Sum_probs=105.1
Q ss_pred CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEE----------------
Q 001655 660 GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCS---------------- 723 (1036)
Q Consensus 660 ~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~---------------- 723 (1036)
.+.+..+.|.++.+.++|++.. +.+++.|..+.+.+..+......++-|+ .|.
T Consensus 217 ~~~vtSv~ws~~G~~LavG~~~----------g~v~iwD~~~~k~~~~~~~~h~~rvg~l-aW~~~~lssGsr~~~I~~~ 285 (484)
T KOG0305|consen 217 EELVTSVKWSPDGSHLAVGTSD----------GTVQIWDVKEQKKTRTLRGSHASRVGSL-AWNSSVLSSGSRDGKILNH 285 (484)
T ss_pred CCceEEEEECCCCCEEEEeecC----------CeEEEEehhhccccccccCCcCceeEEE-eccCceEEEecCCCcEEEE
Confidence 5678889999999999999875 4677777655544443333223333332 221
Q ss_pred -----------------------EcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEe--cc
Q 001655 724 -----------------------FSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSL--NA 778 (1036)
Q Consensus 724 -----------------------l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i--~~ 778 (1036)
.. ....+++-|. ...++.+|+... .--+.+-.++.++|.|+ |+
T Consensus 286 dvR~~~~~~~~~~~H~qeVCgLkws-~d~~~lASGg----------nDN~~~Iwd~~~-~~p~~~~~~H~aAVKA~awcP 353 (484)
T KOG0305|consen 286 DVRISQHVVSTLQGHRQEVCGLKWS-PDGNQLASGG----------NDNVVFIWDGLS-PEPKFTFTEHTAAVKALAWCP 353 (484)
T ss_pred EEecchhhhhhhhcccceeeeeEEC-CCCCeeccCC----------CccceEeccCCC-ccccEEEeccceeeeEeeeCC
Confidence 00 0012222221 223666776521 22234456788888877 46
Q ss_pred ccCeEEE-EECCE---EEEEEeeecCCCccchhcccccccceEEEEEEEeCCE--EE--EEeccccEEEEEEeccCCeEE
Q 001655 779 FNGKLLA-AINQK---IQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDF--IV--VGDLMKSISLLIYKHEEGAIE 850 (1036)
Q Consensus 779 ~~g~Lv~-~~g~~---l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~--I~--vgD~~~Sv~~~~~~~~~~~l~ 850 (1036)
+...|++ |-|.. |++++. .+...+... ++...+.+|.+.+.+ |+ .|....-|.+++|-. -..+.
T Consensus 354 ~q~~lLAsGGGs~D~~i~fwn~----~~g~~i~~v---dtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps-~~~~~ 425 (484)
T KOG0305|consen 354 WQSGLLATGGGSADRCIKFWNT----NTGARIDSV---DTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPS-MKLVA 425 (484)
T ss_pred CccCceEEcCCCcccEEEEEEc----CCCcEeccc---ccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccc-cceee
Confidence 6655554 54443 444332 122333222 344556677765543 44 488888888888754 22222
Q ss_pred EEeccCCcceeEEEEEeeC-ceEEEEccCCcEEEEeeCC
Q 001655 851 ERARDYNANWMSAVEILDD-DIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 851 ~~a~D~~~~~~~~~~~l~~-~~~l~~D~~gnl~~l~~~~ 888 (1036)
.+..... .|.....=.+ .+++.+..+.+|.++..-+
T Consensus 426 ~l~gH~~--RVl~la~SPdg~~i~t~a~DETlrfw~~f~ 462 (484)
T KOG0305|consen 426 ELLGHTS--RVLYLALSPDGETIVTGAADETLRFWNLFD 462 (484)
T ss_pred eecCCcc--eeEEEEECCCCCEEEEecccCcEEeccccC
Confidence 2222211 1333322222 4688888999999988654
No 158
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=73.65 E-value=83 Score=34.65 Aligned_cols=154 Identities=19% Similarity=0.208 Sum_probs=84.4
Q ss_pred ecCceeEeccc--cCeEEEEEC-CEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEecc
Q 001655 769 TKGAVYSLNAF--NGKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHE 845 (1036)
Q Consensus 769 ~~g~v~~i~~~--~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~ 845 (1036)
..+||.|+..- ..+|+.+.| +++++++++.+ ..+.....+..-+..++..-.+..|.-|-...+|.+ |++.
T Consensus 114 H~e~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~Te----Tp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~l--wdpk 187 (480)
T KOG0271|consen 114 HGEAVLSVQFSPTGSRLVTGSGDTTVRLWDLDTE----TPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRL--WDPK 187 (480)
T ss_pred CCCcEEEEEecCCCceEEecCCCceEEeeccCCC----CcceeecCCccEEEEEEECCCcchhhccccCCeEEE--ecCC
Confidence 35677776632 237888887 57788776421 112111122222333444445667777777777765 6766
Q ss_pred CCeEEEEeccCCcceeEEEEEee----C--ceEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEeeee
Q 001655 846 EGAIEERARDYNANWMSAVEILD----D--DIYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRHGSL 919 (1036)
Q Consensus 846 ~~~l~~~a~D~~~~~~~~~~~l~----~--~~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l 919 (1036)
.++..--+=--+..|+++...-. . ..+..+-++|++.+..... .+......-| -..||+++-|
T Consensus 188 tg~~~g~~l~gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~--------~~~~~~lsgH-T~~VTCvrwG-- 256 (480)
T KOG0271|consen 188 TGQQIGRALRGHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKL--------GTCVRTLSGH-TASVTCVRWG-- 256 (480)
T ss_pred CCCcccccccCcccceeEEeecccccCCCccceecccCCCCEEEEEccC--------ceEEEEeccC-ccceEEEEEc--
Confidence 55543333334667888765432 1 1356677899999998653 1222222222 2356666542
Q ss_pred eecCCCCCCCCcceEEE-EccccceEEEEecC
Q 001655 920 VMRLPDSDVGQIPTVIF-GTVNGVIGVIASLP 950 (1036)
Q Consensus 920 ~~~~~~~~~~~~~~il~-~t~~GsIg~l~~l~ 950 (1036)
+..+|| |+-|++|-+....+
T Consensus 257 -----------G~gliySgS~DrtIkvw~a~d 277 (480)
T KOG0271|consen 257 -----------GEGLIYSGSQDRTIKVWRALD 277 (480)
T ss_pred -----------CCceEEecCCCceEEEEEccc
Confidence 233444 46788887766654
No 159
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=72.78 E-value=13 Score=39.35 Aligned_cols=114 Identities=16% Similarity=0.229 Sum_probs=68.1
Q ss_pred CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 661 EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 661 ~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
+..|.|-+||....++|++-++ .++|+|-+|++..-+-. +...+--++..+.... ...+++-|.
T Consensus 217 ~~vrsiSfHPsGefllvgTdHp----------~~rlYdv~T~Qcfvsan-Pd~qht~ai~~V~Ys~-t~~lYvTaS---- 280 (430)
T KOG0640|consen 217 EPVRSISFHPSGEFLLVGTDHP----------TLRLYDVNTYQCFVSAN-PDDQHTGAITQVRYSS-TGSLYVTAS---- 280 (430)
T ss_pred ceeeeEeecCCCceEEEecCCC----------ceeEEeccceeEeeecC-cccccccceeEEEecC-CccEEEEec----
Confidence 3456788999988888887664 79999999888764433 3333434555555543 234455343
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeEEEEECC--EEEEEEe
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKLLAAINQ--KIQLYKW 796 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~Lv~~~g~--~l~v~~~ 796 (1036)
+-|.|.+|+=..++...-......|+--|-+.| ||+.+.+.|. .+++|++
T Consensus 281 ------kDG~IklwDGVS~rCv~t~~~AH~gsevcSa~Ftkn~kyiLsSG~DS~vkLWEi 334 (430)
T KOG0640|consen 281 ------KDGAIKLWDGVSNRCVRTIGNAHGGSEVCSAVFTKNGKYILSSGKDSTVKLWEI 334 (430)
T ss_pred ------cCCcEEeeccccHHHHHHHHhhcCCceeeeEEEccCCeEEeecCCcceeeeeee
Confidence 568888886553333222223344444344444 6777776664 5566554
No 160
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=71.77 E-value=1.5e+02 Score=31.95 Aligned_cols=261 Identities=13% Similarity=0.146 Sum_probs=126.0
Q ss_pred CcEEEEE--eCCCEEEEEEcCCeEEEEEEcCcEEEEEE------eccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEE
Q 001655 437 YSVNVAT--ANASQVLLATGGGHLVYLEIGDGILTEVK------HAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISV 508 (1036)
Q Consensus 437 ~~I~~as--~~~~~vvv~~~~~~~~~l~~~~~~l~~~~------~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i 508 (1036)
..|+..+ .++..++-+..++.+.++.+++ +...+ ..+.+ .++.+.+.| + -.-++|.+-..+++
T Consensus 87 ~~vt~~~FsSdGK~lat~~~Dr~Ir~w~~~D--F~~~eHr~~R~nve~d-hpT~V~Fap--D----c~s~vv~~~~g~~l 157 (420)
T KOG2096|consen 87 KEVTDVAFSSDGKKLATISGDRSIRLWDVRD--FENKEHRCIRQNVEYD-HPTRVVFAP--D----CKSVVVSVKRGNKL 157 (420)
T ss_pred CceeeeEEcCCCceeEEEeCCceEEEEecch--hhhhhhhHhhccccCC-CceEEEECC--C----cceEEEEEccCCEE
Confidence 4566655 4466777777788888887754 22111 12333 457777754 1 23355555557899
Q ss_pred EEEECCCCCe-------eEEecCCCccCceeEEeeeec---CeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccce
Q 001655 509 RIFSLPDLNL-------ITKEHLGGEIIPRSVLLCAFE---GISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPI 578 (1036)
Q Consensus 509 ~i~~l~~l~~-------v~~~~l~~~~~p~si~~~~~~---~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv 578 (1036)
++|.+..-+- +...++.. .--+++.+.+++ +..++.-...|..++.|.+... .|....+.++...-.
T Consensus 158 ~vyk~~K~~dG~~~~~~v~~D~~~f-~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lkGq--~L~~idtnq~~n~~a 234 (420)
T KOG2096|consen 158 CVYKLVKKTDGSGSHHFVHIDNLEF-ERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLKGQ--LLQSIDTNQSSNYDA 234 (420)
T ss_pred EEEEeeecccCCCCccccccccccc-chhcccceEEEeecCCceEEEEecCCCcEEEEecCCc--eeeeeccccccccce
Confidence 9998753111 11111110 001233222221 2233333444444555544311 121111222222222
Q ss_pred EEEEEEeCCceEEEEEcCCceE-----EEecCCcEE----Eeeecc-ccceeeecccCCCCCCeEEEE-eCCeEEEEEEc
Q 001655 579 TLRTFSSKNTTHVFAASDRPTV-----IYSSNKKLL----YSNVNL-KEVSHMCPFNSAAFPDSLAIA-KEGELTIGTID 647 (1036)
Q Consensus 579 ~l~~~~~~~~~~v~~~~~~p~~-----i~~~~~~~~----~~~~~~-~~i~~~~~f~~~~~~~~l~~~-~~~~l~i~~l~ 647 (1036)
.+.| ++..+.++|=.|=+ +|..+|.++ ...+.. +.......|++. ...++-+ .++..+|-..+
T Consensus 235 avSP----~GRFia~~gFTpDVkVwE~~f~kdG~fqev~rvf~LkGH~saV~~~aFsn~--S~r~vtvSkDG~wriwdtd 308 (420)
T KOG2096|consen 235 AVSP----DGRFIAVSGFTPDVKVWEPIFTKDGTFQEVKRVFSLKGHQSAVLAAAFSNS--STRAVTVSKDGKWRIWDTD 308 (420)
T ss_pred eeCC----CCcEEEEecCCCCceEEEEEeccCcchhhhhhhheeccchhheeeeeeCCC--cceeEEEecCCcEEEeecc
Confidence 2222 23445555544422 344455442 112221 222233335432 1234444 46778877665
Q ss_pred CCC------C-eEEEEEeC---CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEe
Q 001655 648 DIQ------K-LHIRSIPL---GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGC 717 (1036)
Q Consensus 648 ~~~------~-~~~~~i~l---~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~ 717 (1036)
-.- + +..-.+|+ |..|-|+...|+.+.+++..- +.|+++...+.+..++++=-..+.+.
T Consensus 309 VrY~~~qDpk~Lk~g~~pl~aag~~p~RL~lsP~g~~lA~s~g-----------s~l~~~~se~g~~~~~~e~~h~~~Is 377 (420)
T KOG2096|consen 309 VRYEAGQDPKILKEGSAPLHAAGSEPVRLELSPSGDSLAVSFG-----------SDLKVFASEDGKDYPELEDIHSTTIS 377 (420)
T ss_pred ceEecCCCchHhhcCCcchhhcCCCceEEEeCCCCcEEEeecC-----------CceEEEEcccCccchhHHHhhcCcee
Confidence 421 1 12222455 467999999999999888754 57999988777766655444444444
Q ss_pred EEEEEEEcCCCc
Q 001655 718 SILSCSFSDDSN 729 (1036)
Q Consensus 718 si~~~~l~~~~~ 729 (1036)
| +.+..+++
T Consensus 378 ~---is~~~~g~ 386 (420)
T KOG2096|consen 378 S---ISYSSDGK 386 (420)
T ss_pred e---EEecCCCc
Confidence 3 34444333
No 161
>KOG4328 consensus WD40 protein [Function unknown]
Probab=70.89 E-value=1.9e+02 Score=32.79 Aligned_cols=97 Identities=13% Similarity=0.139 Sum_probs=60.5
Q ss_pred CCeEEEEEEcCCC--CeEEEEEe----CCC--ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE
Q 001655 638 EGELTIGTIDDIQ--KLHIRSIP----LGE--HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP 709 (1036)
Q Consensus 638 ~~~l~i~~l~~~~--~~~~~~i~----l~~--tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~ 709 (1036)
++.++|....-.. -.+...|+ .++ ||=|.+++|+.+.++|+-... .|.++|++..+.+..+-
T Consensus 390 D~~IRv~dss~~sa~~~p~~~I~Hn~~t~RwlT~fKA~W~P~~~li~vg~~~r----------~IDv~~~~~~q~v~el~ 459 (498)
T KOG4328|consen 390 DNEIRVFDSSCISAKDEPLGTIPHNNRTGRWLTPFKAAWDPDYNLIVVGRYPR----------PIDVFDGNGGQMVCELH 459 (498)
T ss_pred CCceEEeecccccccCCccceeeccCcccccccchhheeCCCccEEEEeccCc----------ceeEEcCCCCEEeeecc
Confidence 6777776653111 11222332 222 567778999888888876543 49999998888777665
Q ss_pred CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEE
Q 001655 710 LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIV 756 (1036)
Q Consensus 710 ~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i 756 (1036)
.+.--.|.|+..|.-. +.-++-|. ...|.||+|.-
T Consensus 460 ~P~~~tI~~vn~~HP~---~~~~~aG~---------~s~Gki~vft~ 494 (498)
T KOG4328|consen 460 DPESSTIPSVNEFHPM---RDTLAAGG---------NSSGKIYVFTN 494 (498)
T ss_pred Cccccccccceeeccc---ccceeccC---------CccceEEEEec
Confidence 5555566777666422 22255554 26799999864
No 162
>PF08596 Lgl_C: Lethal giant larvae(Lgl) like, C-terminal; InterPro: IPR013905 The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=70.39 E-value=2e+02 Score=32.88 Aligned_cols=106 Identities=20% Similarity=0.286 Sum_probs=59.4
Q ss_pred CCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC-------CCCeEeEEEEE--EEcCCC--ceEEEEEeeee
Q 001655 671 QSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD-------TFEYGCSILSC--SFSDDS--NVYYCVGTAYV 739 (1036)
Q Consensus 671 ~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~-------~~E~v~si~~~--~l~~~~--~~~i~VGT~~~ 739 (1036)
+-...+|++.. ++|-++|-..=.+|..-.+. ..+.+++++.. .+..+. ..+++|||
T Consensus 96 ~iGFvaigy~~----------G~l~viD~RGPavI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~ySSi~L~vGT--- 162 (395)
T PF08596_consen 96 DIGFVAIGYES----------GSLVVIDLRGPAVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGYSSICLLVGT--- 162 (395)
T ss_dssp BTSEEEEEETT----------SEEEEEETTTTEEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSSEEEEEEEEE---
T ss_pred CCcEEEEEecC----------CcEEEEECCCCeEEeeccccccccccccccCeeEEEEEEEecCCCcccceEEEEEe---
Confidence 55666666532 57888887666677654433 34566666443 334433 47899999
Q ss_pred CCCCCCCcceEEEEEEEe---CCe--EEEEEEE-EecCceeEecccc------------------------CeEEEEECC
Q 001655 740 LPEENEPTKGRILVFIVE---DGK--LQLIAEK-ETKGAVYSLNAFN------------------------GKLLAAINQ 789 (1036)
Q Consensus 740 ~~~e~~~~~Gri~v~~i~---~~k--l~~~~~~-~~~g~v~~i~~~~------------------------g~Lv~~~g~ 789 (1036)
..|.+++|.+. +++ .+..... ..+++|.+|+.++ |+++++..+
T Consensus 163 -------n~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i~~~~G~~a~At~~~~~~l~~g~~i~g~vVvvSe~ 235 (395)
T PF08596_consen 163 -------NSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPINADTGESALATISAMQGLSKGISIPGYVVVVSES 235 (395)
T ss_dssp -------TTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEEETTT--B-B-BHHHHHGGGGT----EEEEEE-SS
T ss_pred -------CCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEEECCCCCcccCchhHhhccccCCCcCcEEEEEccc
Confidence 45999999998 233 4444444 4578888887662 246666667
Q ss_pred EEEEEEe
Q 001655 790 KIQLYKW 796 (1036)
Q Consensus 790 ~l~v~~~ 796 (1036)
.+++|..
T Consensus 236 ~irv~~~ 242 (395)
T PF08596_consen 236 DIRVFKP 242 (395)
T ss_dssp EEEEE-T
T ss_pred ceEEEeC
Confidence 7777764
No 163
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=70.20 E-value=2.2e+02 Score=33.11 Aligned_cols=89 Identities=22% Similarity=0.413 Sum_probs=57.1
Q ss_pred cCceeEeccc-cCeEEEEEC--CEEEEEEeeecCCCccchhcc-cccccceEEEEEEEeCCEEEEEeccccEEEEEEecc
Q 001655 770 KGAVYSLNAF-NGKLLAAIN--QKIQLYKWMLRDDGTRELQSE-CGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHE 845 (1036)
Q Consensus 770 ~g~v~~i~~~-~g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~~-~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~ 845 (1036)
+|++...+.. +|+.+++++ ..|+||.++ ..+|+.. -+|-.-...++-+-.|.||++|---+=|+++.|-
T Consensus 290 ~g~in~f~FS~DG~~LA~VSqDGfLRvF~fd-----t~eLlg~mkSYFGGLLCvcWSPDGKyIvtGGEDDLVtVwSf~-- 362 (636)
T KOG2394|consen 290 EGSINEFAFSPDGKYLATVSQDGFLRIFDFD-----TQELLGVMKSYFGGLLCVCWSPDGKYIVTGGEDDLVTVWSFE-- 362 (636)
T ss_pred cccccceeEcCCCceEEEEecCceEEEeecc-----HHHHHHHHHhhccceEEEEEcCCccEEEecCCcceEEEEEec--
Confidence 3455555544 566666655 578999874 3456543 2343444555556678899999999989887664
Q ss_pred CCeEEEEecc-CCcceeEEEEEe
Q 001655 846 EGAIEERARD-YNANWMSAVEIL 867 (1036)
Q Consensus 846 ~~~l~~~a~D-~~~~~~~~~~~l 867 (1036)
+.++ +||- -+.-||+.+.|=
T Consensus 363 erRV--VARGqGHkSWVs~VaFD 383 (636)
T KOG2394|consen 363 ERRV--VARGQGHKSWVSVVAFD 383 (636)
T ss_pred cceE--EEeccccccceeeEeec
Confidence 4444 5554 355688888773
No 164
>PF11768 DUF3312: Protein of unknown function (DUF3312); InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=69.62 E-value=2.3e+02 Score=33.29 Aligned_cols=109 Identities=17% Similarity=0.272 Sum_probs=64.8
Q ss_pred CCeEEEEecCcEEEEecCCccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEE
Q 001655 406 YNQLVQVTSGSVRLVSSTSRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCL 483 (1036)
Q Consensus 406 ~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l 483 (1036)
+..+.+++.+.++.+. +.. .|-...+++++.+ +..++++..+|.++.++...+ ..... ..+.-++.+
T Consensus 237 d~ciYE~~r~klqrvs------vts--ipL~s~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~-~t~~~--ka~~~P~~i 305 (545)
T PF11768_consen 237 DSCIYECSRNKLQRVS------VTS--IPLPSQVICCARSPSEDKLVLGCEDGSIILYDTTRG-VTLLA--KAEFIPTLI 305 (545)
T ss_pred EEEEEEeecCceeEEE------EEE--EecCCcceEEecCcccceEEEEecCCeEEEEEcCCC-eeeee--eecccceEE
Confidence 4456667666655442 122 2344567777766 668888888999998876543 22222 223345667
Q ss_pred EcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeE
Q 001655 484 DINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSV 533 (1036)
Q Consensus 484 ~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si 533 (1036)
+..| .+.+++||.. .|.+++|++- +.++..+-++.+..|.+.
T Consensus 306 aWHp------~gai~~V~s~-qGelQ~FD~A-Lspi~~qLlsEd~~P~~~ 347 (545)
T PF11768_consen 306 AWHP------DGAIFVVGSE-QGELQCFDMA-LSPIKMQLLSEDATPKST 347 (545)
T ss_pred EEcC------CCcEEEEEcC-CceEEEEEee-cCccceeeccccCCCccE
Confidence 7654 2568888877 8999999863 333333334334455544
No 165
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=69.32 E-value=1.6e+02 Score=31.12 Aligned_cols=135 Identities=12% Similarity=0.118 Sum_probs=71.7
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEEEEeCCCEEEEEEcC-----CeEEEEEEcC--cEEEE---EEeccC-CceeEE
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNVATANASQVLLATGG-----GHLVYLEIGD--GILTE---VKHAQL-EYEISC 482 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~as~~~~~vvv~~~~-----~~~~~l~~~~--~~l~~---~~~~~l-~~~is~ 482 (1036)
.+.+++.+-++++.+..|+.+...+...-+..+++++++.+. +.+-++++.+ ..+.. ..+.+. +..|+.
T Consensus 73 D~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~ 152 (327)
T KOG0643|consen 73 DQTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITS 152 (327)
T ss_pred cceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceee
Confidence 467889998888999999876533333333446677766633 3455556542 11111 111111 122332
Q ss_pred EEcCCCCCCCCcccEEEEEEecCCEEEEEECCCC-CeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEE
Q 001655 483 LDINPIGENPSYSQIAAVGMWTDISVRIFSLPDL-NLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLL 558 (1036)
Q Consensus 483 l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l-~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~ 558 (1036)
.-..+ .+++++.|.. +|+|.+|++.+. +.+-+...-. ....++.+. .++.+.+-|.+|-.-..+.+
T Consensus 153 a~Wg~------l~~~ii~Ghe-~G~is~~da~~g~~~v~s~~~h~-~~Ind~q~s--~d~T~FiT~s~Dttakl~D~ 219 (327)
T KOG0643|consen 153 ALWGP------LGETIIAGHE-DGSISIYDARTGKELVDSDEEHS-SKINDLQFS--RDRTYFITGSKDTTAKLVDV 219 (327)
T ss_pred eeecc------cCCEEEEecC-CCcEEEEEcccCceeeechhhhc-ccccccccc--CCcceEEecccCccceeeec
Confidence 22222 3567777766 999999999863 4443222211 122233222 24566677777765554443
No 166
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=69.10 E-value=1.5e+02 Score=31.05 Aligned_cols=144 Identities=15% Similarity=0.218 Sum_probs=88.6
Q ss_pred ccceEEEec-CCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 662 HPRRICHQE-QSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 662 tp~~i~y~~-~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
....++.+| +.+.|+.++... .+++.|..+.+.+...+..-++.. ..|.- ..+|++||..
T Consensus 66 svdql~w~~~~~d~~atas~dk----------~ir~wd~r~~k~~~~i~~~~eni~---i~wsp---~g~~~~~~~k--- 126 (313)
T KOG1407|consen 66 SVDQLCWDPKHPDLFATASGDK----------TIRIWDIRSGKCTARIETKGENIN---ITWSP---DGEYIAVGNK--- 126 (313)
T ss_pred chhhheeCCCCCcceEEecCCc----------eEEEEEeccCcEEEEeeccCcceE---EEEcC---CCCEEEEecC---
Confidence 345556554 455666666543 789999988888888776654443 23432 3578888853
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeEEEEEC-CEEEEEEeeecCCCccchhcccccccce-
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHI- 816 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~- 816 (1036)
.-+|-.+++.+ .+.+..++++--+..++-- ++..+...| .++.+.+|. .|.+.-....++
T Consensus 127 -------dD~it~id~r~--~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~ILsyp-------sLkpv~si~AH~s 190 (313)
T KOG1407|consen 127 -------DDRITFIDART--YKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEILSYP-------SLKPVQSIKAHPS 190 (313)
T ss_pred -------cccEEEEEecc--cceeehhcccceeeeeeecCCCCEEEEecCCceEEEEecc-------ccccccccccCCc
Confidence 23666666654 4445556666656555533 445666777 788898873 133332223332
Q ss_pred --EEEEEEEeCCEEEEEeccccEEEE
Q 001655 817 --LALYVQTRGDFIVVGDLMKSISLL 840 (1036)
Q Consensus 817 --~~~~l~~~~~~I~vgD~~~Sv~~~ 840 (1036)
+++.+.-.|.+..+|-+--.+++.
T Consensus 191 nCicI~f~p~GryfA~GsADAlvSLW 216 (313)
T KOG1407|consen 191 NCICIEFDPDGRYFATGSADALVSLW 216 (313)
T ss_pred ceEEEEECCCCceEeeccccceeecc
Confidence 345555678899998887777764
No 167
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=68.04 E-value=60 Score=38.12 Aligned_cols=203 Identities=14% Similarity=0.087 Sum_probs=101.9
Q ss_pred CceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEE-----EEEEEEecCceeEeccccC--eEEEEEC-CEEEEEEeeec
Q 001655 728 SNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQ-----LIAEKETKGAVYSLNAFNG--KLLAAIN-QKIQLYKWMLR 799 (1036)
Q Consensus 728 ~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~-----~~~~~~~~g~v~~i~~~~g--~Lv~~~g-~~l~v~~~~~~ 799 (1036)
.++.|+|+- -.|.|.+|+....+.+ +..-.-+.++|..+....| .||-+.| +++++|+.+..
T Consensus 63 ~eHiLavad----------E~G~i~l~dt~~~~fr~ee~~lk~~~aH~nAifDl~wapge~~lVsasGDsT~r~Wdvk~s 132 (720)
T KOG0321|consen 63 KEHILAVAD----------EDGGIILFDTKSIVFRLEERQLKKPLAHKNAIFDLKWAPGESLLVSASGDSTIRPWDVKTS 132 (720)
T ss_pred ccceEEEec----------CCCceeeecchhhhcchhhhhhcccccccceeEeeccCCCceeEEEccCCceeeeeeeccc
Confidence 467777773 3478888887743333 2333346788988888865 5676666 78888776422
Q ss_pred CC-Cc-------cchhcccccccceEEEEEEEeCCEEEEEeccccE--EEEEE--------eccCCeEEEEec-------
Q 001655 800 DD-GT-------RELQSECGHHGHILALYVQTRGDFIVVGDLMKSI--SLLIY--------KHEEGAIEERAR------- 854 (1036)
Q Consensus 800 ~~-~~-------~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv--~~~~~--------~~~~~~l~~~a~------- 854 (1036)
.. |. ..+...|+......+...--.++-|++-|++-.. .+.+| +..+....+.++
T Consensus 133 ~l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA 212 (720)
T KOG0321|consen 133 RLVGGRLNLGHTGSVKSECFMPTNPAVFCTGGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKA 212 (720)
T ss_pred eeecceeecccccccchhhhccCCCcceeeccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhcccccccc
Confidence 11 10 1122234443333233333345567777776654 11111 110001111111
Q ss_pred --cCCcceeEEEEEeeCceEEEEcc-CCcEEEEeeCCCCCCcccccceeEEEEEEcCCcc-ceEEeeeeeecCCCCCCCC
Q 001655 855 --DYNANWMSAVEILDDDIYLGAEN-NFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFV-NRFRHGSLVMRLPDSDVGQ 930 (1036)
Q Consensus 855 --D~~~~~~~~~~~l~~~~~l~~D~-~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v-~~~~~~~l~~~~~~~~~~~ 930 (1036)
....-.||.+.|.|+++++.+-. ++.|-+++....... .+.++.+.-.+...- .+.-..+|.. ...
T Consensus 213 ~s~ti~ssvTvv~fkDe~tlaSaga~D~~iKVWDLRk~~~~----~r~ep~~~~~~~t~skrs~G~~nL~l------Dss 282 (720)
T KOG0321|consen 213 ASNTIFSSVTVVLFKDESTLASAGAADSTIKVWDLRKNYTA----YRQEPRGSDKYPTHSKRSVGQVNLIL------DSS 282 (720)
T ss_pred ccCceeeeeEEEEEeccceeeeccCCCcceEEEeecccccc----cccCCCcccCccCcccceeeeEEEEe------cCC
Confidence 11112467788889888876555 888888876532211 122222211111111 1111122221 123
Q ss_pred cceEEEEccccceEEEEecC
Q 001655 931 IPTVIFGTVNGVIGVIASLP 950 (1036)
Q Consensus 931 ~~~il~~t~~GsIg~l~~l~ 950 (1036)
+..++..+.|++|+++-...
T Consensus 283 Gt~L~AsCtD~sIy~ynm~s 302 (720)
T KOG0321|consen 283 GTYLFASCTDNSIYFYNMRS 302 (720)
T ss_pred CCeEEEEecCCcEEEEeccc
Confidence 45666667899999876664
No 168
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=67.72 E-value=1.7e+02 Score=30.89 Aligned_cols=261 Identities=16% Similarity=0.141 Sum_probs=143.7
Q ss_pred cceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCC
Q 001655 663 PRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPE 742 (1036)
Q Consensus 663 p~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~ 742 (1036)
.+.|-|..+..++.- |.+. +..-+.-..+++.+.+|+=-.+-..+|-..| ...+++-|.+-+
T Consensus 13 lTqiKyN~eGDLlFs-caKD---------~~~~vw~s~nGerlGty~GHtGavW~~Did~-----~s~~liTGSAD~--- 74 (327)
T KOG0643|consen 13 LTQIKYNREGDLLFS-CAKD---------STPTVWYSLNGERLGTYDGHTGAVWCCDIDW-----DSKHLITGSADQ--- 74 (327)
T ss_pred cceEEecCCCcEEEE-ecCC---------CCceEEEecCCceeeeecCCCceEEEEEecC-----Ccceeeeccccc---
Confidence 345667777665443 3321 1222222235677777764444333222222 256777777532
Q ss_pred CCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCe-EEEEE----CC--EEEEEEeeecCC--Cccc-hhcccc
Q 001655 743 ENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGK-LLAAI----NQ--KIQLYKWMLRDD--GTRE-LQSECG 811 (1036)
Q Consensus 743 e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~-Lv~~~----g~--~l~v~~~~~~~~--~~~~-L~~~~~ 811 (1036)
.+.+|++..+|. ++..+++.||..+.-. +|. ++++. |+ .|.+|++...+. ...+ +.+...
T Consensus 75 -------t~kLWDv~tGk~--la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t 145 (327)
T KOG0643|consen 75 -------TAKLWDVETGKQ--LATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPT 145 (327)
T ss_pred -------eeEEEEcCCCcE--EEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecC
Confidence 467888877654 6777888888887744 454 44543 33 345666532110 0111 111110
Q ss_pred cccceEEEEE--EEeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCce-EEEEccCCcEEEEeeCC
Q 001655 812 HHGHILALYV--QTRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDI-YLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 812 ~~~~~~~~~l--~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~-~l~~D~~gnl~~l~~~~ 888 (1036)
.+ .-+++. ...+.+|+.|+-.-++.. |+...++...-+.+.+...++.+++-.+.+ ++.+-++.+-.++...
T Consensus 146 ~~--skit~a~Wg~l~~~ii~Ghe~G~is~--~da~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~Dttakl~D~~- 220 (327)
T KOG0643|consen 146 PD--SKITSALWGPLGETIIAGHEDGSISI--YDARTGKELVDSDEEHSSKINDLQFSRDRTYFITGSKDTTAKLVDVR- 220 (327)
T ss_pred Cc--cceeeeeecccCCEEEEecCCCcEEE--EEcccCceeeechhhhccccccccccCCcceEEecccCccceeeecc-
Confidence 01 123332 346889999999999874 676665444334445555777777766555 5666677776666542
Q ss_pred CCCCcccccceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEc--------cccceEEEEecChhHHHHHH-H
Q 001655 889 EGATDEERGRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGT--------VNGVIGVIASLPHEQYLFLE-K 959 (1036)
Q Consensus 889 ~~~~~~~~~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t--------~~GsIg~l~~l~~~~~~~L~-~ 959 (1036)
.|+..-.|..-..||+-.... ...+.++.|+ .++..| +=+.|+++ .
T Consensus 221 ---------tl~v~Kty~te~PvN~aaisP----------~~d~VilgGGqeA~dVTTT~~r~G------KFEArFyh~i 275 (327)
T KOG0643|consen 221 ---------TLEVLKTYTTERPVNTAAISP----------LLDHVILGGGQEAMDVTTTSTRAG------KFEARFYHLI 275 (327)
T ss_pred ---------ceeeEEEeeecccccceeccc----------ccceEEecCCceeeeeeeeccccc------chhhhHHHHH
Confidence 566666676667776643211 1223333333 233333 22346665 5
Q ss_pred HHHHHHhcccCCCCCCccccc
Q 001655 960 LQTNLRKVIKGVGGLNHEQWR 980 (1036)
Q Consensus 960 lq~~l~~~~~~~~gl~~~~~R 980 (1036)
+|..+.+...|+|-+|.-+|.
T Consensus 276 ~eEEigrvkGHFGPINsvAfh 296 (327)
T KOG0643|consen 276 FEEEIGRVKGHFGPINSVAFH 296 (327)
T ss_pred HHHHhccccccccCcceeEEC
Confidence 788888888889888877664
No 169
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=67.71 E-value=26 Score=38.63 Aligned_cols=110 Identities=19% Similarity=0.228 Sum_probs=64.5
Q ss_pred ccceEEEecCCC-EEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 662 HPRRICHQEQSR-TFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 662 tp~~i~y~~~~~-~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
..|-++++|..+ ++.++... ..|+++|-.+-.++.+|... + .+-|+ .|-+ +..++|.-|-
T Consensus 195 ~IrdlafSp~~~GLl~~asl~----------nkiki~dlet~~~vssy~a~-~-~~wSC-~wDl--de~h~IYaGl---- 255 (463)
T KOG1645|consen 195 FIRDLAFSPFNEGLLGLASLG----------NKIKIMDLETSCVVSSYIAY-N-QIWSC-CWDL--DERHVIYAGL---- 255 (463)
T ss_pred hhhhhccCccccceeeeeccC----------ceEEEEecccceeeeheecc-C-Cceee-eecc--CCcceeEEec----
Confidence 456778888777 44444443 37899998887777777655 2 22222 2433 4478888775
Q ss_pred CCCCCCcceEEEEEEEeCC--eEEEEEEEEecCceeEecccc-------CeEEEEECCEEEEEEe
Q 001655 741 PEENEPTKGRILVFIVEDG--KLQLIAEKETKGAVYSLNAFN-------GKLLAAINQKIQLYKW 796 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~--kl~~~~~~~~~g~v~~i~~~~-------g~Lv~~~g~~l~v~~~ 796 (1036)
.+|-+|+|++... -+-.........||..|+++. |.++++.-.-+..|++
T Consensus 256 ------~nG~VlvyD~R~~~~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~lt~l~f~ei 314 (463)
T KOG1645|consen 256 ------QNGMVLVYDMRQPEGPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFALTVLQFYEI 314 (463)
T ss_pred ------cCceEEEEEccCCCchHhhhhhhhccCcceeecccCccccccccceEEeeehhhhhhhh
Confidence 5799999999832 121222223445666666653 2344554444444443
No 170
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=67.49 E-value=2.3e+02 Score=32.34 Aligned_cols=274 Identities=18% Similarity=0.242 Sum_probs=130.2
Q ss_pred CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC-C-----CeeEE--ecCCCccCc--eeEEeeeec-CeEEE
Q 001655 476 LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD-L-----NLITK--EHLGGEIIP--RSVLLCAFE-GISYL 544 (1036)
Q Consensus 476 l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~-l-----~~v~~--~~l~~~~~p--~si~~~~~~-~~~~L 544 (1036)
-+.||.|.+-.|+. ...++.|.- +...++++|.. - +.+.. ........| +.+--+.++ +...|
T Consensus 177 ~~~~V~~~~WnP~~-----~~llasg~~-~s~ari~~l~e~~~~~~~q~~lrh~~~~~~~s~~~nkdVT~L~Wn~~G~~L 250 (524)
T KOG0273|consen 177 HESEVFICAWNPLR-----DGLLASGSG-DSTARIWNLLENSNIGSTQLVLRHCIREGGKSVPSNKDVTSLDWNNDGTLL 250 (524)
T ss_pred CCCceEEEecCchh-----hhhhhccCC-ccceeeeeehhhccccchhhhhhhhhhhhcccCCccCCcceEEecCCCCeE
Confidence 45677777776643 235555544 55677777764 1 11111 111111122 222222332 56778
Q ss_pred EEEeCCCcEEEEEEecCCCccccceeeecC--ccceEEEEEE-eCCceEEEEEc-CCceEEEecC-Cc-EEEeeeccccc
Q 001655 545 LCALGDGHLLNFLLNMKTGELTDRKKVSLG--TQPITLRTFS-SKNTTHVFAAS-DRPTVIYSSN-KK-LLYSNVNLKEV 618 (1036)
Q Consensus 545 ~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG--~~pv~l~~~~-~~~~~~v~~~~-~~p~~i~~~~-~~-~~~~~~~~~~i 618 (1036)
..|..||.+-.|..+.. +. ..+| ..|+ ..++ ...++.++..| |+..++.... +. .+..++...+
T Consensus 251 atG~~~G~~riw~~~G~---l~----~tl~~HkgPI--~slKWnk~G~yilS~~vD~ttilwd~~~g~~~q~f~~~s~~- 320 (524)
T KOG0273|consen 251 ATGSEDGEARIWNKDGN---LI----STLGQHKGPI--FSLKWNKKGTYILSGGVDGTTILWDAHTGTVKQQFEFHSAP- 320 (524)
T ss_pred EEeecCcEEEEEecCch---hh----hhhhccCCce--EEEEEcCCCCEEEeccCCccEEEEeccCceEEEeeeeccCC-
Confidence 88999999999887532 11 1222 2343 2232 22334455555 3333333221 21 1111111111
Q ss_pred eeeecccCCCC-CCeEEE-EeCCeEEEEEEcCCCCeEEEEEe-CCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEE
Q 001655 619 SHMCPFNSAAF-PDSLAI-AKEGELTIGTIDDIQKLHIRSIP-LGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVR 695 (1036)
Q Consensus 619 ~~~~~f~~~~~-~~~l~~-~~~~~l~i~~l~~~~~~~~~~i~-l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~ 695 (1036)
.++.+=. .+-|+. .+++.+++|+++.... ++++. =......+-|.|..++++-++.+ .+++
T Consensus 321 ----~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P--~~t~~GH~g~V~alk~n~tg~LLaS~SdD----------~Tlk 384 (524)
T KOG0273|consen 321 ----ALDVDWQSNDEFATSSTDGCIHVCKVGEDRP--VKTFIGHHGEVNALKWNPTGSLLASCSDD----------GTLK 384 (524)
T ss_pred ----ccceEEecCceEeecCCCceEEEEEecCCCc--ceeeecccCceEEEEECCCCceEEEecCC----------CeeE
Confidence 0111101 124444 4588999999986542 22222 12345567788776665554433 5788
Q ss_pred EEeCCCceEEEEEECCCCC-eEeEEEEEEEcCC-----CceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEE-E
Q 001655 696 LLDDQTFEFISTYPLDTFE-YGCSILSCSFSDD-----SNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEK-E 768 (1036)
Q Consensus 696 l~d~~t~~~i~~~~~~~~E-~v~si~~~~l~~~-----~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~-~ 768 (1036)
+.+-+... ....|..++ .+.++ .|.-... +....+... ...+.+.+|+++.+.. +|.. .
T Consensus 385 iWs~~~~~--~~~~l~~Hskei~t~-~wsp~g~v~~n~~~~~~l~sa---------s~dstV~lwdv~~gv~--i~~f~k 450 (524)
T KOG0273|consen 385 IWSMGQSN--SVHDLQAHSKEIYTI-KWSPTGPVTSNPNMNLMLASA---------SFDSTVKLWDVESGVP--IHTLMK 450 (524)
T ss_pred eeecCCCc--chhhhhhhccceeeE-eecCCCCccCCCcCCceEEEe---------ecCCeEEEEEccCCce--eEeecc
Confidence 87643222 122333333 23333 2322110 111122122 2456888898876543 4444 6
Q ss_pred ecCceeEeccc-cCeEEEE--ECCEEEEEE
Q 001655 769 TKGAVYSLNAF-NGKLLAA--INQKIQLYK 795 (1036)
Q Consensus 769 ~~g~v~~i~~~-~g~Lv~~--~g~~l~v~~ 795 (1036)
...|||+++.. +|+.++. .+..|+++.
T Consensus 451 H~~pVysvafS~~g~ylAsGs~dg~V~iws 480 (524)
T KOG0273|consen 451 HQEPVYSVAFSPNGRYLASGSLDGCVHIWS 480 (524)
T ss_pred CCCceEEEEecCCCcEEEecCCCCeeEecc
Confidence 78899999977 4544433 224566644
No 171
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=67.00 E-value=2e+02 Score=31.45 Aligned_cols=186 Identities=13% Similarity=0.088 Sum_probs=108.4
Q ss_pred EEEeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEec--CCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECC
Q 001655 634 AIAKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQE--QSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLD 711 (1036)
Q Consensus 634 ~~~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~--~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~ 711 (1036)
+..+++.++|....+.+.+-.-|.+ ..+..-+.+.. .-+.+..++++ +.|+++|-.+......+.+.
T Consensus 45 v~lSngsv~lyd~~tg~~l~~fk~~-~~~~N~vrf~~~ds~h~v~s~ssD----------G~Vr~wD~Rs~~e~a~~~~~ 113 (376)
T KOG1188|consen 45 VSLSNGSVRLYDKGTGQLLEEFKGP-PATTNGVRFISCDSPHGVISCSSD----------GTVRLWDIRSQAESARISWT 113 (376)
T ss_pred EEecCCeEEEEeccchhhhheecCC-CCcccceEEecCCCCCeeEEeccC----------CeEEEEEeecchhhhheecc
Confidence 3456888888887775433211111 12223333333 23333444443 58999998888777777776
Q ss_pred CCC--eEeEEEEEEEcCC-CceEEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEEEEecCceeEeccc---cCeEE
Q 001655 712 TFE--YGCSILSCSFSDD-SNVYYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAEKETKGAVYSLNAF---NGKLL 784 (1036)
Q Consensus 712 ~~E--~v~si~~~~l~~~-~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~~~~~g~v~~i~~~---~g~Lv 784 (1036)
.+- ...|+ ..+ +++.++-||.... .--.+++|++.+. ++--.....+..-||+++-. .+.|+
T Consensus 114 ~~~~~~f~~l-----d~nck~~ii~~GtE~~~------s~A~v~lwDvR~~qq~l~~~~eSH~DDVT~lrFHP~~pnlLl 182 (376)
T KOG1188|consen 114 QQSGTPFICL-----DLNCKKNIIACGTELTR------SDASVVLWDVRSEQQLLRQLNESHNDDVTQLRFHPSDPNLLL 182 (376)
T ss_pred CCCCCcceEe-----eccCcCCeEEecccccc------CceEEEEEEeccccchhhhhhhhccCcceeEEecCCCCCeEE
Confidence 655 33333 222 4788998986544 4568999999854 32223445678889999855 23455
Q ss_pred EE-ECCEEEEEEeeecCCCccchhcccccccceEEEEEEEeC---CEEEEEeccccEEEEEEec
Q 001655 785 AA-INQKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRG---DFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 785 ~~-~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~---~~I~vgD~~~Sv~~~~~~~ 844 (1036)
.| +..-+-+|+.+. ++.+.-|...+-+.+ .+-.+.+.+ .+|++-+=|.+...+.+..
T Consensus 183 SGSvDGLvnlfD~~~-d~EeDaL~~viN~~s--SI~~igw~~~~ykrI~clTH~Etf~~~ele~ 243 (376)
T KOG1188|consen 183 SGSVDGLVNLFDTKK-DNEEDALLHVINHGS--SIHLIGWLSKKYKRIMCLTHMETFAIYELED 243 (376)
T ss_pred eecccceEEeeecCC-CcchhhHHHhhcccc--eeeeeeeecCCcceEEEEEccCceeEEEccC
Confidence 43 445667888753 233344555432221 223344433 3799999999988877654
No 172
>PF10433 MMS1_N: Mono-functional DNA-alkylating methyl methanesulfonate N-term; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 2B5N_C 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A ....
Probab=66.96 E-value=2.7e+02 Score=33.07 Aligned_cols=324 Identities=11% Similarity=0.132 Sum_probs=146.9
Q ss_pred CEEEEEEcCCeEEEEEEcC--cEE-EEE--EeccCC-------ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECC
Q 001655 447 SQVLLATGGGHLVYLEIGD--GIL-TEV--KHAQLE-------YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLP 514 (1036)
Q Consensus 447 ~~vvv~~~~~~~~~l~~~~--~~l-~~~--~~~~l~-------~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~ 514 (1036)
+.++|+.+.+.+.+++++. .++ .+. ...++. ..-.-+++.| .+..++++.+ ++.+.||.+.
T Consensus 1 D~L~v~tdsg~l~~l~~~~~~~~~~~~~v~~~~~~~~~~~r~~~~G~~l~vDP------~~R~i~v~a~-e~~~~v~~l~ 73 (504)
T PF10433_consen 1 DSLVVTTDSGKLSILEYDPSTHGFFKEFVHQWEPLSKSGSRLSQPGQYLAVDP------SGRCIAVSAY-EGNFLVYPLN 73 (504)
T ss_dssp -EEEEEETTTEEEEEEEEEETTEE-E-EEEEEEE---SSSEB-TT--EEEE-T------TSSEEEEEEB-TTEEEEEE-S
T ss_pred CEEEEEECCCCEEEEEEECCCCccceeeEEEeEecCCCCCChhcCCcEEEECC------cCCEEEEEec-CCeEEEEEec
Confidence 3578888888888888764 232 211 111111 1112344443 3678899989 9999999987
Q ss_pred C-C------CeeEEecCCCccCceeEEeee---ecCeEEEE--EEeCCC--cEEEEEEecCCCccccce--eee--c---
Q 001655 515 D-L------NLITKEHLGGEIIPRSVLLCA---FEGISYLL--CALGDG--HLLNFLLNMKTGELTDRK--KVS--L--- 573 (1036)
Q Consensus 515 ~-l------~~v~~~~l~~~~~p~si~~~~---~~~~~~L~--vgl~~G--~l~~y~~~~~~~~l~~~~--~~~--l--- 573 (1036)
. . ......++..+...-+++++. -...+.+. .-..++ .+..|+++...+.....+ ... +
T Consensus 74 ~~~~~~~~~~~~~~~pi~s~~~i~~~~FL~~~~~~~~p~la~L~~~~~~~~~~~~y~w~~~~~l~~~~~~~~~~~~l~~~ 153 (504)
T PF10433_consen 74 RSLDSDIAFSPHINSPIKSEGNILDMCFLHPSVGYDNPTLAILYVDSQRRTHLVTYEWSLDDGLNHVISKSTLPIRLPNE 153 (504)
T ss_dssp S----T-TT---EEEE--S-SEEEEEEEES---S-SS-EEEEEEEETT-EEEEEEEE--------EETTTTEEEE--EEE
T ss_pred ccccccccccccccccccCCceEEEEEEEecccCCCCceEEEEEEEecccceeEEEeeecccccceeeeecccccccccc
Confidence 5 0 011112221112233444443 11233322 222333 345666543322111111 111 1
Q ss_pred CccceEEEEEEeCCceEEEEEcCCceEEEec---CCcEEEeeecc-----ccc-eee-eccc---CCCCCCeEEEEe-CC
Q 001655 574 GTQPITLRTFSSKNTTHVFAASDRPTVIYSS---NKKLLYSNVNL-----KEV-SHM-CPFN---SAAFPDSLAIAK-EG 639 (1036)
Q Consensus 574 G~~pv~l~~~~~~~~~~v~~~~~~p~~i~~~---~~~~~~~~~~~-----~~i-~~~-~~f~---~~~~~~~l~~~~-~~ 639 (1036)
-..|..|.|+.. ...+++++++.-.+.... .+...+.++.. ..+ .+. .|.. ...-.+.+++.+ .|
T Consensus 154 ~~~p~~LIPlp~-~~ggllV~~~~~i~y~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~~~lL~~e~G 232 (504)
T PF10433_consen 154 DELPSFLIPLPN-PPGGLLVGGENIIIYKNHLIGSGDYSFLSIPSPPSSSSSLWTSWARPERNISYDKDGDRILLQDEDG 232 (504)
T ss_dssp E-TTEEEEEE-T-TT-SEEEEESSEEEEEE------TTEEEEE--H-HHHTS-EEEEEE------SSTTSSEEEEEETTS
T ss_pred CCCccEEEEcCC-CCcEEEEECCEEEEEecccccccccccccccCCccCCCceEEEEEeccccceecCCCCEEEEEeCCC
Confidence 124677788753 345678777766555432 12222222221 122 111 1221 111223455554 67
Q ss_pred eEEEEEEcCCC-CeEEEEEeC-CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEE-CCCCCeE
Q 001655 640 ELTIGTIDDIQ-KLHIRSIPL-GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYP-LDTFEYG 716 (1036)
Q Consensus 640 ~l~i~~l~~~~-~~~~~~i~l-~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~-~~~~E~v 716 (1036)
.|....+.... .+.++.+-- ...+..++|....+-++++.++. + -+.+.-+....++.++++. ..| +
T Consensus 233 ~l~~l~l~~~~~~i~i~~~g~~~~~~s~l~~l~~g~d~lf~gs~~---g----ds~l~~~~~~~l~~~~~~~N~~P---i 302 (504)
T PF10433_consen 233 DLYLLTLDNDGGSISITYLGTLCSIASSLTYLKNGGDYLFVGSEF---G----DSQLLQISLSNLEVLDSLPNWGP---I 302 (504)
T ss_dssp EEEEEEEEEEEEEEEEEEEEE--S-ESEEEEESTT--EEEEEESS---S-----EEEEEEESESEEEEEEE----S---E
T ss_pred eEEEEEEEECCCeEEEEEcCCcCChhheEEEEcCCCEEEEEEEec---C----CcEEEEEeCCCcEEEEeccCcCC---c
Confidence 88888887655 334444332 34567788887653344444432 1 1344444455566665542 333 4
Q ss_pred eEEEEEEEcCCCce------EEEEEeeeeCCCCCCCcceEEEEEEEeCCeEE--EEEEEEecCceeEeccc------cCe
Q 001655 717 CSILSCSFSDDSNV------YYCVGTAYVLPEENEPTKGRILVFIVEDGKLQ--LIAEKETKGAVYSLNAF------NGK 782 (1036)
Q Consensus 717 ~si~~~~l~~~~~~------~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~--~~~~~~~~g~v~~i~~~------~g~ 782 (1036)
..++.......+.. -++.+++. -.+|.|.+++-. -.++ .+...+.+| |+.+=.+ +.+
T Consensus 303 ~D~~v~~~~~~~~~~~~~~~~lv~~sG~-------g~~gsL~~lr~G-i~~~~~~~~~~~l~~-v~~iW~l~~~~~~~~~ 373 (504)
T PF10433_consen 303 VDFCVVDSSNSGQPSNPSSDQLVACSGA-------GKRGSLRILRNG-IGIEGLELASSELPG-VTGIWTLKLSSSDHSY 373 (504)
T ss_dssp EEEEEE-TSSSSS-------EEEEEESS-------GGG-EEEEEEES-BEEE--EEEEEEEST-EEEEEEE-SSSSSBSE
T ss_pred cceEEeccccCCCCcccccceEEEEECc-------CCCCcEEEEecc-CCceeeeeeccCCCC-ceEEEEeeecCCCceE
Confidence 44444433222222 55555542 267999888532 1455 666777877 6665444 347
Q ss_pred EEEEECCEEEEEEee
Q 001655 783 LLAAINQKIQLYKWM 797 (1036)
Q Consensus 783 Lv~~~g~~l~v~~~~ 797 (1036)
|+++.-..-+++.+.
T Consensus 374 lv~S~~~~T~vl~~~ 388 (504)
T PF10433_consen 374 LVLSFPNETRVLQIS 388 (504)
T ss_dssp EEEEESSEEEEEEES
T ss_pred EEEEcCCceEEEEEe
Confidence 888988888888874
No 173
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=65.70 E-value=57 Score=36.29 Aligned_cols=75 Identities=15% Similarity=0.189 Sum_probs=52.8
Q ss_pred ECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEecccc--CeEE-E
Q 001655 709 PLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFN--GKLL-A 785 (1036)
Q Consensus 709 ~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~--g~Lv-~ 785 (1036)
....+|.+.|+.. ++..+|+++|| ..|.+.+|+..+-+.-.+.++-+.+-|++++-.. .++. +
T Consensus 277 ~~~~~~siSsl~V----S~dGkf~AlGT----------~dGsVai~~~~~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~sv 342 (398)
T KOG0771|consen 277 KIKRFKSISSLAV----SDDGKFLALGT----------MDGSVAIYDAKSLQRLQYVKEAHLGFVTGLTFSPDSRYLASV 342 (398)
T ss_pred hhhccCcceeEEE----cCCCcEEEEec----------cCCcEEEEEeceeeeeEeehhhheeeeeeEEEcCCcCccccc
Confidence 3456777877754 35679999999 4689999998765555566677888999888552 2333 5
Q ss_pred EECCEEEEEEee
Q 001655 786 AINQKIQLYKWM 797 (1036)
Q Consensus 786 ~~g~~l~v~~~~ 797 (1036)
+.+++..+..+.
T Consensus 343 Ss~~~~~v~~l~ 354 (398)
T KOG0771|consen 343 SSDNEAAVTKLA 354 (398)
T ss_pred ccCCceeEEEEe
Confidence 666777776664
No 174
>PF07433 DUF1513: Protein of unknown function (DUF1513); InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=64.81 E-value=1.1e+02 Score=33.33 Aligned_cols=116 Identities=19% Similarity=0.177 Sum_probs=78.6
Q ss_pred EeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEe
Q 001655 657 IPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGT 736 (1036)
Q Consensus 657 i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT 736 (1036)
+||..-.+-++.+|.....++..-++ ...+.++|+.+.+.+..+.-+++.+.+-=.. |..+++-++. |
T Consensus 1 ~~lP~RgH~~a~~p~~~~avafaRRP--------G~~~~v~D~~~g~~~~~~~a~~gRHFyGHg~--fs~dG~~Lyt--T 68 (305)
T PF07433_consen 1 IPLPARGHGVAAHPTRPEAVAFARRP--------GTFALVFDCRTGQLLQRLWAPPGRHFYGHGV--FSPDGRLLYT--T 68 (305)
T ss_pred CCCCccccceeeCCCCCeEEEEEeCC--------CcEEEEEEcCCCceeeEEcCCCCCEEecCEE--EcCCCCEEEE--e
Confidence 35556677888999777666666554 2467788999998888777777777543322 3334443333 3
Q ss_pred eeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecC-ceeEeccc-cC-eEEEEECC
Q 001655 737 AYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKG-AVYSLNAF-NG-KLLAAINQ 789 (1036)
Q Consensus 737 ~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g-~v~~i~~~-~g-~Lv~~~g~ 789 (1036)
. ++.+..+|+|=||+.. ..++.+.+....| .++.+.-. +| .|++|.|.
T Consensus 69 E----nd~~~g~G~IgVyd~~-~~~~ri~E~~s~GIGPHel~l~pDG~tLvVANGG 119 (305)
T PF07433_consen 69 E----NDYETGRGVIGVYDAA-RGYRRIGEFPSHGIGPHELLLMPDGETLVVANGG 119 (305)
T ss_pred c----cccCCCcEEEEEEECc-CCcEEEeEecCCCcChhhEEEcCCCCEEEEEcCC
Confidence 2 3456789999999997 5788888877765 45555544 45 78888885
No 175
>cd00216 PQQ_DH Dehydrogenases with pyrrolo-quinoline quinone (PQQ) as cofactor, like ethanol, methanol, and membrane bound glucose dehydrogenases. The alignment model contains an 8-bladed beta-propeller.
Probab=64.79 E-value=3e+02 Score=32.66 Aligned_cols=62 Identities=15% Similarity=0.042 Sum_probs=37.4
Q ss_pred eeEEEEEEeCCCceEEEEEECCCCCe-----EeEEEEEEE---cCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeE
Q 001655 690 EMHFVRLLDDQTFEFISTYPLDTFEY-----GCSILSCSF---SDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKL 761 (1036)
Q Consensus 690 ~~~~l~l~d~~t~~~i~~~~~~~~E~-----v~si~~~~l---~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl 761 (1036)
..+.|.=+|.+|++.+.+++..+... ..+...... ..+...++++|+ ..|+++.++..++++
T Consensus 254 ~~~~l~Ald~~tG~~~W~~~~~~~~~~~~~~~s~p~~~~~~~~~g~~~~~V~~g~----------~~G~l~ald~~tG~~ 323 (488)
T cd00216 254 YTDSIVALDADTGKVKWFYQTTPHDLWDYDGPNQPSLADIKPKDGKPVPAIVHAP----------KNGFFYVLDRTTGKL 323 (488)
T ss_pred ceeeEEEEcCCCCCEEEEeeCCCCCCcccccCCCCeEEeccccCCCeeEEEEEEC----------CCceEEEEECCCCcE
Confidence 34577778999999998887654321 111111111 111234666676 468999999887754
No 176
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=63.87 E-value=2.4e+02 Score=34.21 Aligned_cols=110 Identities=16% Similarity=0.192 Sum_probs=66.0
Q ss_pred ceeeeecCCCeEEEEecCcEEEEecCCccceeeeeCCC----------CCcEEEEEeC--CCEEEEEEcCCeEEEEEEcC
Q 001655 398 TLFCHDAIYNQLVQVTSGSVRLVSSTSRELRNEWKSPP----------GYSVNVATAN--ASQVLLATGGGHLVYLEIGD 465 (1036)
Q Consensus 398 Tl~~~~~~~~~~vQVt~~~i~l~~~~~~~~~~~w~~~~----------~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~ 465 (1036)
-|++|-+.+-.-++++|++-.+.++..-+.+.-|..-. -.+|++.+.+ +.+++-+..++.+.+-++..
T Consensus 529 RifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~GH~~~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~~ 608 (707)
T KOG0263|consen 529 RIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFTGHKGPVTALAFSPCGRYLASGDEDGLIKIWDLAN 608 (707)
T ss_pred hhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEecCCCCceEEEEEcCCCceEeecccCCcEEEEEcCC
Confidence 35555555555666666666655543323344454222 1356666544 55676666677787778766
Q ss_pred cEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 466 GILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 466 ~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
+++...-.-. ...|.++.++. .+.++++|.- |+++.+|++..
T Consensus 609 ~~~v~~l~~H-t~ti~SlsFS~------dg~vLasgg~-DnsV~lWD~~~ 650 (707)
T KOG0263|consen 609 GSLVKQLKGH-TGTIYSLSFSR------DGNVLASGGA-DNSVRLWDLTK 650 (707)
T ss_pred Ccchhhhhcc-cCceeEEEEec------CCCEEEecCC-CCeEEEEEchh
Confidence 5443321111 56677888753 3678888877 99999998754
No 177
>COG5276 Uncharacterized conserved protein [Function unknown]
Probab=60.15 E-value=2.4e+02 Score=30.36 Aligned_cols=121 Identities=11% Similarity=-0.019 Sum_probs=79.8
Q ss_pred EEEEEEecCceeEeccccCeEEEEEC-CEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEE
Q 001655 763 LIAEKETKGAVYSLNAFNGKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLI 841 (1036)
Q Consensus 763 ~~~~~~~~g~v~~i~~~~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~ 841 (1036)
++.....++-+..+..-.++..+|-+ +-++++++...+ + -..+.++++.-++-...+.||+.+|+|...++-++.
T Consensus 79 l~~~i~~~~l~~Dv~vse~yvyvad~ssGL~IvDIS~P~--s--P~~~~~lnt~gyaygv~vsGn~aYVadlddgfLivd 154 (370)
T COG5276 79 LLSVINARDLFADVRVSEEYVYVADWSSGLRIVDISTPD--S--PTLIGFLNTDGYAYGVYVSGNYAYVADLDDGFLIVD 154 (370)
T ss_pred eEEEEehhhhhheeEecccEEEEEcCCCceEEEeccCCC--C--cceeccccCCceEEEEEecCCEEEEeeccCcEEEEE
Confidence 45555556666555544566666655 467887775332 1 122345555445666777899999999999975543
Q ss_pred EeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCC
Q 001655 842 YKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 842 ~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~ 888 (1036)
.. ++.+=.+.+|-..+-|-+.-..++.+.-.+++.++.|.++....
T Consensus 155 vs-dpssP~lagrya~~~~d~~~v~ISGn~AYvA~~d~GL~ivDVSn 200 (370)
T COG5276 155 VS-DPSSPQLAGRYALPGGDTHDVAISGNYAYVAWRDGGLTIVDVSN 200 (370)
T ss_pred CC-CCCCceeeeeeccCCCCceeEEEecCeEEEEEeCCCeEEEEccC
Confidence 32 34455666776666666555566777778999999999999864
No 178
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=59.66 E-value=1.3e+02 Score=35.72 Aligned_cols=114 Identities=17% Similarity=0.215 Sum_probs=67.6
Q ss_pred cEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEE-EEEEecc-CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEEC
Q 001655 438 SVNVATAN--ASQVLLATGGGHLVYLEIGDGIL-TEVKHAQ-LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSL 513 (1036)
Q Consensus 438 ~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l-~~~~~~~-l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l 513 (1036)
+|.+|+.+ +.++++...+|++.. .-..++- ..+.+.- -...|-.++.+|.. ++...+.++|.-| +.++.+|+|
T Consensus 134 R~~~CsWtnDGqylalG~~nGTIsi-RNk~gEek~~I~Rpgg~Nspiwsi~~~p~s-g~G~~di~aV~DW-~qTLSFy~L 210 (1081)
T KOG1538|consen 134 RIICCSWTNDGQYLALGMFNGTISI-RNKNGEEKVKIERPGGSNSPIWSICWNPSS-GEGRNDILAVADW-GQTLSFYQL 210 (1081)
T ss_pred eEEEeeecCCCcEEEEeccCceEEe-ecCCCCcceEEeCCCCCCCCceEEEecCCC-CCCccceEEEEec-cceeEEEEe
Confidence 56666643 557888887888755 2211211 1122211 12345566665422 2234678999999 889999999
Q ss_pred CCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEE
Q 001655 514 PDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLL 558 (1036)
Q Consensus 514 ~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~ 558 (1036)
+.-.+--...|. +-|..+.. +.+..|+++|-.||.|-.|.=
T Consensus 211 sG~~Igk~r~L~--FdP~CisY--f~NGEy~LiGGsdk~L~~fTR 251 (1081)
T KOG1538|consen 211 SGKQIGKDRALN--FDPCCISY--FTNGEYILLGGSDKQLSLFTR 251 (1081)
T ss_pred cceeecccccCC--CCchhhee--ccCCcEEEEccCCCceEEEee
Confidence 762221122343 45655533 345689999999999988764
No 179
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=59.57 E-value=2.8e+02 Score=30.63 Aligned_cols=253 Identities=12% Similarity=0.134 Sum_probs=126.7
Q ss_pred EEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccC
Q 001655 450 LLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEII 529 (1036)
Q Consensus 450 vv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~ 529 (1036)
+.+.+++.+..+...+++++.-- +--...+-.+++.. +...++.+-.|-.+.+|++.......+..+..+..
T Consensus 124 ~~as~d~tikv~D~~tg~~e~~L-rGHt~sv~di~~~a-------~Gk~l~tcSsDl~~~LWd~~~~~~c~ks~~gh~h~ 195 (406)
T KOG0295|consen 124 VSASEDATIKVFDTETGELERSL-RGHTDSVFDISFDA-------SGKYLATCSSDLSAKLWDFDTFFRCIKSLIGHEHG 195 (406)
T ss_pred EEecCCceEEEEEccchhhhhhh-hccccceeEEEEec-------CccEEEecCCccchhheeHHHHHHHHHHhcCcccc
Confidence 33445788888877766663211 11112244455532 33455666656667777765521111112233456
Q ss_pred ceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCcc-ceEEEEEEeCCceEEEEEcCCce----EEEec
Q 001655 530 PRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQ-PITLRTFSSKNTTHVFAASDRPT----VIYSS 604 (1036)
Q Consensus 530 p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~-pv~l~~~~~~~~~~v~~~~~~p~----~i~~~ 604 (1036)
..++.+.+.+ .+++-..+|..+..++++..- .....-|.. =|++.+ .++.-.+++.|+.-- |....
T Consensus 196 vS~V~f~P~g--d~ilS~srD~tik~We~~tg~-----cv~t~~~h~ewvr~v~--v~~DGti~As~s~dqtl~vW~~~t 266 (406)
T KOG0295|consen 196 VSSVFFLPLG--DHILSCSRDNTIKAWECDTGY-----CVKTFPGHSEWVRMVR--VNQDGTIIASCSNDQTLRVWVVAT 266 (406)
T ss_pred eeeEEEEecC--CeeeecccccceeEEecccce-----eEEeccCchHhEEEEE--ecCCeeEEEecCCCceEEEEEecc
Confidence 6778777765 788888899988887776431 111111211 144433 334446777665432 22222
Q ss_pred C---CcEEEeeeccccceeeecccC-----CCCC-----CeEEE-EeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEec
Q 001655 605 N---KKLLYSNVNLKEVSHMCPFNS-----AAFP-----DSLAI-AKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQE 670 (1036)
Q Consensus 605 ~---~~~~~~~~~~~~i~~~~~f~~-----~~~~-----~~l~~-~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~ 670 (1036)
+ .-++-+... -...+.+|+.. ++-+ +.+.. ..++.++|=.++.. ..-..-...+.=.+-++++|
T Consensus 267 ~~~k~~lR~hEh~-vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg-~cL~tL~ghdnwVr~~af~p 344 (406)
T KOG0295|consen 267 KQCKAELREHEHP-VECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTG-MCLFTLVGHDNWVRGVAFSP 344 (406)
T ss_pred chhhhhhhccccc-eEEEEecccccCcchhhccCCCCCccEEEeecccceEEEEeccCC-eEEEEEecccceeeeeEEcC
Confidence 2 111111100 01223333322 1111 12222 23666777666653 11122223345577889998
Q ss_pred CCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEe
Q 001655 671 QSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGT 736 (1036)
Q Consensus 671 ~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT 736 (1036)
..+ |++.|.+. .+|++.|-++.+.+...+ ++|+.... .-|.. ...|++-|.
T Consensus 345 ~Gk-yi~ScaDD---------ktlrvwdl~~~~cmk~~~--ah~hfvt~--lDfh~-~~p~VvTGs 395 (406)
T KOG0295|consen 345 GGK-YILSCADD---------KTLRVWDLKNLQCMKTLE--AHEHFVTS--LDFHK-TAPYVVTGS 395 (406)
T ss_pred CCe-EEEEEecC---------CcEEEEEeccceeeeccC--CCcceeEE--EecCC-CCceEEecc
Confidence 765 77777653 589999988877666544 66664332 22332 244555443
No 180
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=59.50 E-value=3e+02 Score=30.94 Aligned_cols=194 Identities=16% Similarity=0.214 Sum_probs=105.2
Q ss_pred CCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeee
Q 001655 660 GEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYV 739 (1036)
Q Consensus 660 ~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~ 739 (1036)
..+..-|.++|+.+ |+++|.-. -++.+.|..|++....|+=..+-.+.|+ .|- ++ +. .+++|.
T Consensus 269 ~~~V~yi~wSPDdr-yLlaCg~~---------e~~~lwDv~tgd~~~~y~~~~~~S~~sc-~W~-pD-g~-~~V~Gs--- 331 (519)
T KOG0293|consen 269 SQPVSYIMWSPDDR-YLLACGFD---------EVLSLWDVDTGDLRHLYPSGLGFSVSSC-AWC-PD-GF-RFVTGS--- 331 (519)
T ss_pred cCceEEEEECCCCC-eEEecCch---------HheeeccCCcchhhhhcccCcCCCccee-EEc-cC-Cc-eeEecC---
Confidence 35666788899866 66666532 1488888888776655443323444443 342 22 23 366665
Q ss_pred CCCCCCCcceEEEEEEEeCCe---EEEEEEEEecCceeEecc-ccCe--EEEEECCEEEEEEeeecCCCccchhcccccc
Q 001655 740 LPEENEPTKGRILVFIVEDGK---LQLIAEKETKGAVYSLNA-FNGK--LLAAINQKIQLYKWMLRDDGTRELQSECGHH 813 (1036)
Q Consensus 740 ~~~e~~~~~Gri~v~~i~~~k---l~~~~~~~~~g~v~~i~~-~~g~--Lv~~~g~~l~v~~~~~~~~~~~~L~~~~~~~ 813 (1036)
..+.++.++.+.+. .+-+- .-.|+.++. .+|+ ++++..+++.+|..+.+. .+.+.. -.
T Consensus 332 -------~dr~i~~wdlDgn~~~~W~gvr----~~~v~dlait~Dgk~vl~v~~d~~i~l~~~e~~~--dr~lis---e~ 395 (519)
T KOG0293|consen 332 -------PDRTIIMWDLDGNILGNWEGVR----DPKVHDLAITYDGKYVLLVTVDKKIRLYNREARV--DRGLIS---EE 395 (519)
T ss_pred -------CCCcEEEecCCcchhhcccccc----cceeEEEEEcCCCcEEEEEecccceeeechhhhh--hhcccc---cc
Confidence 23667777776321 11111 123555552 3554 456777889998864221 111221 22
Q ss_pred cceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEEE-eccCCcceeEEEEEeeCc-e-EEEEccCCcEEEEeeCC
Q 001655 814 GHILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEER-ARDYNANWMSAVEILDDD-I-YLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 814 ~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~-a~D~~~~~~~~~~~l~~~-~-~l~~D~~gnl~~l~~~~ 888 (1036)
.++...+++-.+.+++|-=.-+.+.+..+. +++++.- .--...+.+...+|=..+ . ++.+-.++.+++..+..
T Consensus 396 ~~its~~iS~d~k~~LvnL~~qei~LWDl~--e~~lv~kY~Ghkq~~fiIrSCFgg~~~~fiaSGSED~kvyIWhr~s 471 (519)
T KOG0293|consen 396 QPITSFSISKDGKLALVNLQDQEIHLWDLE--ENKLVRKYFGHKQGHFIIRSCFGGGNDKFIASGSEDSKVYIWHRIS 471 (519)
T ss_pred CceeEEEEcCCCcEEEEEcccCeeEEeecc--hhhHHHHhhcccccceEEEeccCCCCcceEEecCCCceEEEEEccC
Confidence 333444555556688888888888775443 4444321 112233455544554333 4 45555689999988654
No 181
>PF00325 Crp: Bacterial regulatory proteins, crp family; InterPro: IPR001808 Numerous bacterial transcription regulatory proteins bind DNA via a helix-turn-helix (HTH) motif. These proteins are very diverse, but for convenience may be grouped into subfamilies on the basis of sequence similarity. This family groups together a range of proteins, including anr, crp, clp, cysR, fixK, flp, fnr, fnrN, hlyX and ntcA [, ]. Within this family, the HTH motif is situated towards the C terminus.; GO: 0003700 sequence-specific DNA binding transcription factor activity, 0006355 regulation of transcription, DNA-dependent, 0005622 intracellular; PDB: 2OZ6_A 1CGP_B 2GZW_C 1O3T_B 3ROU_A 2CGP_A 3RDI_A 1I5Z_A 3IYD_H 3FWE_B ....
Probab=59.38 E-value=13 Score=25.30 Aligned_cols=25 Identities=16% Similarity=0.380 Sum_probs=20.9
Q ss_pred HHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1010 RMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1010 ~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
.+++||+-+|.++|.+.+.+..|++
T Consensus 4 tr~diA~~lG~t~ETVSR~l~~l~~ 28 (32)
T PF00325_consen 4 TRQDIADYLGLTRETVSRILKKLER 28 (32)
T ss_dssp -HHHHHHHHTS-HHHHHHHHHHHHH
T ss_pred CHHHHHHHhCCcHHHHHHHHHHHHH
Confidence 4689999999999999999988875
No 182
>PF13360 PQQ_2: PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=58.38 E-value=2.3e+02 Score=29.29 Aligned_cols=172 Identities=12% Similarity=0.060 Sum_probs=92.3
Q ss_pred EEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEE-EEEEec
Q 001655 692 HFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLI-AEKETK 770 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~-~~~~~~ 770 (1036)
..|..+|..+++.+.++++ +++..... . .. ...++|++ ..|+++.++...+++.-. .....+
T Consensus 46 ~~l~~~d~~tG~~~W~~~~-~~~~~~~~-~--~~---~~~v~v~~----------~~~~l~~~d~~tG~~~W~~~~~~~~ 108 (238)
T PF13360_consen 46 GNLYALDAKTGKVLWRFDL-PGPISGAP-V--VD---GGRVYVGT----------SDGSLYALDAKTGKVLWSIYLTSSP 108 (238)
T ss_dssp SEEEEEETTTSEEEEEEEC-SSCGGSGE-E--EE---TTEEEEEE----------TTSEEEEEETTTSCEEEEEEE-SSC
T ss_pred CEEEEEECCCCCEEEEeec-ccccccee-e--ec---cccccccc----------ceeeeEecccCCcceeeeecccccc
Confidence 5788999999999999998 33322221 1 11 34455555 235888888776665433 222211
Q ss_pred --C--ceeEeccccCeEEEEE-CCEEEEEEeeecCCCccchhcccccc---cc-----eEEEEEEEeCCEEEEEeccccE
Q 001655 771 --G--AVYSLNAFNGKLLAAI-NQKIQLYKWMLRDDGTRELQSECGHH---GH-----ILALYVQTRGDFIVVGDLMKSI 837 (1036)
Q Consensus 771 --g--~v~~i~~~~g~Lv~~~-g~~l~v~~~~~~~~~~~~L~~~~~~~---~~-----~~~~~l~~~~~~I~vgD~~~Sv 837 (1036)
+ ...+....++.++++. +..|+.++.. +|+.......... .. .....+...++.|++++....
T Consensus 109 ~~~~~~~~~~~~~~~~~~~~~~~g~l~~~d~~---tG~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~v~~~~~~g~- 184 (238)
T PF13360_consen 109 PAGVRSSSSPAVDGDRLYVGTSSGKLVALDPK---TGKLLWKYPVGEPRGSSPISSFSDINGSPVISDGRVYVSSGDGR- 184 (238)
T ss_dssp TCSTB--SEEEEETTEEEEEETCSEEEEEETT---TTEEEEEEESSTT-SS--EEEETTEEEEEECCTTEEEEECCTSS-
T ss_pred ccccccccCceEecCEEEEEeccCcEEEEecC---CCcEEEEeecCCCCCCcceeeecccccceEEECCEEEEEcCCCe-
Confidence 1 1112222266787777 6788776642 3543222111110 00 011233344568888887776
Q ss_pred EEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCC
Q 001655 838 SLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 838 ~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~ 888 (1036)
++.++...++..- .++... ..+....+++.+++.+.+++++.++...
T Consensus 185 -~~~~d~~tg~~~w-~~~~~~--~~~~~~~~~~~l~~~~~~~~l~~~d~~t 231 (238)
T PF13360_consen 185 -VVAVDLATGEKLW-SKPISG--IYSLPSVDGGTLYVTSSDGRLYALDLKT 231 (238)
T ss_dssp -EEEEETTTTEEEE-EECSS---ECECEECCCTEEEEEETTTEEEEEETTT
T ss_pred -EEEEECCCCCEEE-EecCCC--ccCCceeeCCEEEEEeCCCEEEEEECCC
Confidence 3455666666433 333222 2232345566777777899999998653
No 183
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=58.33 E-value=3.1e+02 Score=32.20 Aligned_cols=107 Identities=12% Similarity=0.163 Sum_probs=68.5
Q ss_pred CceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEE-EEecCceeEecccc-CeEEEEECCEEEEEEeeecCCCccc
Q 001655 728 SNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAE-KETKGAVYSLNAFN-GKLLAAINQKIQLYKWMLRDDGTRE 805 (1036)
Q Consensus 728 ~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~-~~~~g~v~~i~~~~-g~Lv~~~g~~l~v~~~~~~~~~~~~ 805 (1036)
+..+++.|| .+|.+.+|.+..++++-..+ -...|+|.++..-+ -..+.++|...++-.|++++ ++
T Consensus 69 ~t~~lvlgt----------~~g~v~~ys~~~g~it~~~st~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~---~~ 135 (541)
T KOG4547|consen 69 DTSMLVLGT----------PQGSVLLYSVAGGEITAKLSTDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKE---KV 135 (541)
T ss_pred CceEEEeec----------CCccEEEEEecCCeEEEEEecCCCCCcceeeecccccCceEecCCceeEEEEeccc---ce
Confidence 467899998 56999999999888886554 56889999988553 36788888888887786542 23
Q ss_pred hhccccccc-ceEEEEEEEeCCEEEEEeccccEEEEEEeccCCeEEE
Q 001655 806 LQSECGHHG-HILALYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEE 851 (1036)
Q Consensus 806 L~~~~~~~~-~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~ 851 (1036)
+.++ +.. ...+.++....+-=+.+.+.+.+.++ +.+..+...
T Consensus 136 ~~~~--~~~~~~~~~sl~is~D~~~l~~as~~ik~~--~~~~kevv~ 178 (541)
T KOG4547|consen 136 IIRI--WKEQKPLVSSLCISPDGKILLTASRQIKVL--DIETKEVVI 178 (541)
T ss_pred eeee--eccCCCccceEEEcCCCCEEEeccceEEEE--EccCceEEE
Confidence 3322 222 22344454444422344566776664 555555443
No 184
>PF14781 BBS2_N: Ciliary BBSome complex subunit 2, N-terminal
Probab=57.73 E-value=79 Score=29.72 Aligned_cols=54 Identities=19% Similarity=0.209 Sum_probs=39.3
Q ss_pred CCCCeEeEEEEEEEc-CCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEec
Q 001655 711 DTFEYGCSILSCSFS-DDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLN 777 (1036)
Q Consensus 711 ~~~E~v~si~~~~l~-~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~ 777 (1036)
.=++.+.|++.-.|+ .+.+..|+|||.. .|+.|++.+++ -++.++++..|.+|.
T Consensus 45 Nin~~italaaG~l~~~~~~D~LliGt~t-----------~llaYDV~~N~--d~Fyke~~DGvn~i~ 99 (136)
T PF14781_consen 45 NINQEITALAAGRLKPDDGRDCLLIGTQT-----------SLLAYDVENNS--DLFYKEVPDGVNAIV 99 (136)
T ss_pred ECCCceEEEEEEecCCCCCcCEEEEeccc-----------eEEEEEcccCc--hhhhhhCccceeEEE
Confidence 345678899999887 4568999999853 78999998543 245566777777664
No 185
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=57.41 E-value=5.4e+02 Score=33.27 Aligned_cols=89 Identities=15% Similarity=0.291 Sum_probs=59.4
Q ss_pred ceeeeeCC----CCCcEEEEE--eCCCEEEEEEcCCeEEEEEE----cCcEEEEEEeccCCceeEEEEcCCCCCCCCccc
Q 001655 427 LRNEWKSP----PGYSVNVAT--ANASQVLLATGGGHLVYLEI----GDGILTEVKHAQLEYEISCLDINPIGENPSYSQ 496 (1036)
Q Consensus 427 ~~~~w~~~----~~~~I~~as--~~~~~vvv~~~~~~~~~l~~----~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~ 496 (1036)
.+.+|..+ .+..|+... .....+++++.+|.++.+.. +...++.+. .++..|.|++.+| ..+
T Consensus 62 ~l~s~~~~~~~~~~~~ivs~~yl~d~~~l~~~~~~Gdi~~~~~~~~~~~~~~E~VG--~vd~GI~a~~WSP------D~E 133 (928)
T PF04762_consen 62 VLASWDAPLPDDPNDKIVSFQYLADSESLCIALASGDIILVREDPDPDEDEIEIVG--SVDSGILAASWSP------DEE 133 (928)
T ss_pred EEEeccccCCcCCCCcEEEEEeccCCCcEEEEECCceEEEEEccCCCCCceeEEEE--EEcCcEEEEEECC------CcC
Confidence 45566532 334676666 33567888888899888733 334566665 3567789999876 267
Q ss_pred EEEEEEecCCEEEEEECCCCCeeEEecCC
Q 001655 497 IAAVGMWTDISVRIFSLPDLNLITKEHLG 525 (1036)
Q Consensus 497 ~~~vg~w~~~~i~i~~l~~l~~v~~~~l~ 525 (1036)
.+++.+- ++++.+.+ .+++++....+.
T Consensus 134 lla~vT~-~~~l~~mt-~~fd~i~E~~l~ 160 (928)
T PF04762_consen 134 LLALVTG-EGNLLLMT-RDFDPISEVPLD 160 (928)
T ss_pred EEEEEeC-CCEEEEEe-ccceEEEEeecC
Confidence 7888877 77777765 578887766664
No 186
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=57.08 E-value=63 Score=35.93 Aligned_cols=36 Identities=28% Similarity=0.356 Sum_probs=30.4
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLIT 520 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~ 520 (1036)
..|||++.+. .++++++|+- +|++.||...+|+.+.
T Consensus 282 ~siSsl~VS~------dGkf~AlGT~-dGsVai~~~~~lq~~~ 317 (398)
T KOG0771|consen 282 KSISSLAVSD------DGKFLALGTM-DGSVAIYDAKSLQRLQ 317 (398)
T ss_pred CcceeEEEcC------CCcEEEEecc-CCcEEEEEeceeeeeE
Confidence 4789999864 4789999998 9999999999888754
No 187
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=56.77 E-value=1.8e+02 Score=32.87 Aligned_cols=93 Identities=13% Similarity=0.102 Sum_probs=57.5
Q ss_pred CCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCC---eeEEecCCCccCce
Q 001655 455 GGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLN---LITKEHLGGEIIPR 531 (1036)
Q Consensus 455 ~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~---~v~~~~l~~~~~p~ 531 (1036)
++++++-.++.++....- .....+|.|+++.+. ...+++-|++ ++++.++...+.. .-++. +.-.+
T Consensus 265 D~TV~lWD~~~g~p~~s~-~~~~k~Vq~l~wh~~-----~p~~LLsGs~-D~~V~l~D~R~~~~s~~~wk~----~g~VE 333 (463)
T KOG0270|consen 265 DKTVKLWDVDTGKPKSSI-THHGKKVQTLEWHPY-----EPSVLLSGSY-DGTVALKDCRDPSNSGKEWKF----DGEVE 333 (463)
T ss_pred CceEEEEEcCCCCcceeh-hhcCCceeEEEecCC-----CceEEEeccc-cceEEeeeccCccccCceEEe----ccceE
Confidence 466666677665443322 135678999998653 2578888988 9999999876411 11110 11222
Q ss_pred eEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 532 SVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 532 si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
.+... .....+.+||+.||.|..|.+.
T Consensus 334 kv~w~-~~se~~f~~~tddG~v~~~D~R 360 (463)
T KOG0270|consen 334 KVAWD-PHSENSFFVSTDDGTVYYFDIR 360 (463)
T ss_pred EEEec-CCCceeEEEecCCceEEeeecC
Confidence 33222 2246788999999988877654
No 188
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=56.28 E-value=2e+02 Score=35.08 Aligned_cols=170 Identities=14% Similarity=0.133 Sum_probs=87.5
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
..+||.++. ..+++.|+. .|.++++..+..- ...+. ..++ -.+..|+-.+..||.+++..
T Consensus 40 D~is~~av~--------~~~~~~GtH-~g~v~~~~~~~~~---~~~~~--~s~~------~~~Gey~asCS~DGkv~I~s 99 (846)
T KOG2066|consen 40 DAISCCAVH--------DKFFALGTH-RGAVYLTTCQGNP---KTNFD--HSSS------ILEGEYVASCSDDGKVVIGS 99 (846)
T ss_pred hHHHHHHhh--------cceeeeccc-cceEEEEecCCcc---ccccc--cccc------ccCCceEEEecCCCcEEEee
Confidence 345777663 578999999 9999999876421 11111 1111 12467888888899988887
Q ss_pred EecCCCccccceeeecCccceEEEEEE---eCCceEEEEEcCCceEEEecC---CcEEEeeec--cccceeeecccCCCC
Q 001655 558 LNMKTGELTDRKKVSLGTQPITLRTFS---SKNTTHVFAASDRPTVIYSSN---KKLLYSNVN--LKEVSHMCPFNSAAF 629 (1036)
Q Consensus 558 ~~~~~~~l~~~~~~~lG~~pv~l~~~~---~~~~~~v~~~~~~p~~i~~~~---~~~~~~~~~--~~~i~~~~~f~~~~~ 629 (1036)
+...... ....++ +|++-..++ ....+.-|+.|...-++...+ |+..-.-++ .++|.+++- .
T Consensus 100 l~~~~~~----~~~df~-rpiksial~Pd~~~~~sk~fv~GG~aglvL~er~wlgnk~~v~l~~~eG~I~~i~W-----~ 169 (846)
T KOG2066|consen 100 LFTDDEI----TQYDFK-RPIKSIALHPDFSRQQSKQFVSGGMAGLVLSERNWLGNKDSVVLSEGEGPIHSIKW-----R 169 (846)
T ss_pred ccCCccc----eeEecC-CcceeEEeccchhhhhhhheeecCcceEEEehhhhhcCccceeeecCccceEEEEe-----c
Confidence 6543211 001111 222222221 011223344443331222211 111000111 134444331 1
Q ss_pred CCeEEEEeCCeEEEEEEcCCC-----CeEEEEEeCCCccceEEEecCCCEEEEE
Q 001655 630 PDSLAIAKEGELTIGTIDDIQ-----KLHIRSIPLGEHPRRICHQEQSRTFAIC 678 (1036)
Q Consensus 630 ~~~l~~~~~~~l~i~~l~~~~-----~~~~~~i~l~~tp~~i~y~~~~~~~~v~ 678 (1036)
++.++.+++.+++++..+..+ +++.++......|-++.++++.+ ++++
T Consensus 170 g~lIAWand~Gv~vyd~~~~~~l~~i~~p~~~~R~e~fpphl~W~~~~~-LVIG 222 (846)
T KOG2066|consen 170 GNLIAWANDDGVKVYDTPTRQRLTNIPPPSQSVRPELFPPHLHWQDEDR-LVIG 222 (846)
T ss_pred CcEEEEecCCCcEEEeccccceeeccCCCCCCCCcccCCCceEecCCCe-EEEe
Confidence 346777889999999988765 34445555566777888887655 3443
No 189
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=55.96 E-value=4.7e+02 Score=33.88 Aligned_cols=123 Identities=15% Similarity=0.118 Sum_probs=69.0
Q ss_pred eeeCCCCCcEEEEE--eCCCEEEEEEcCCeEEEEEEcC--cE---EEEEEeccCCc---eeEEEEcCCCCCCCCcccEEE
Q 001655 430 EWKSPPGYSVNVAT--ANASQVLLATGGGHLVYLEIGD--GI---LTEVKHAQLEY---EISCLDINPIGENPSYSQIAA 499 (1036)
Q Consensus 430 ~w~~~~~~~I~~as--~~~~~vvv~~~~~~~~~l~~~~--~~---l~~~~~~~l~~---~is~l~~~~~~~~~~~~~~~~ 499 (1036)
.|.+ .+.++.+.. -++++++++.++|.+..+.++. .. ........+.. -+++-+... ...+..++
T Consensus 1093 tys~-~~sr~~~vt~~~~~~~~Av~t~DG~v~~~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~----~~~S~~lv 1167 (1431)
T KOG1240|consen 1093 TYSP-EGSRVEKVTMCGNGDQFAVSTKDGSVRVLRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTA----IVQSHVLV 1167 (1431)
T ss_pred EEec-cCCceEEEEeccCCCeEEEEcCCCeEEEEEccccccccceeeeeecccccCCCceEEeecccc----cccceeEE
Confidence 3443 445555554 3478999999899998888764 11 11122222222 233333321 11244555
Q ss_pred EEEecCCEEEEEECCCCCeeEEecCC-CccCceeEEeeeecCeEEEEEEeCCCcEEEEEEec
Q 001655 500 VGMWTDISVRIFSLPDLNLITKEHLG-GEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 500 vg~w~~~~i~i~~l~~l~~v~~~~l~-~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
.++- .+.+..|......-.+....+ ......|+++.. ...++++|+..|.+..|.+..
T Consensus 1168 y~T~-~~~iv~~D~r~~~~~w~lk~~~~hG~vTSi~idp--~~~WlviGts~G~l~lWDLRF 1226 (1431)
T KOG1240|consen 1168 YATD-LSRIVSWDTRMRHDAWRLKNQLRHGLVTSIVIDP--WCNWLVIGTSRGQLVLWDLRF 1226 (1431)
T ss_pred EEEe-ccceEEecchhhhhHHhhhcCccccceeEEEecC--CceEEEEecCCceEEEEEeec
Confidence 5554 566777876554433321111 113445665554 346999999999999998764
No 190
>PTZ00420 coronin; Provisional
Probab=55.93 E-value=4.4e+02 Score=31.81 Aligned_cols=75 Identities=8% Similarity=0.045 Sum_probs=48.6
Q ss_pred CcEEEEEeCC--CEEEE-EEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEEC
Q 001655 437 YSVNVATANA--SQVLL-ATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSL 513 (1036)
Q Consensus 437 ~~I~~as~~~--~~vvv-~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l 513 (1036)
..|.+.+.++ ..+++ +..++.+.+.++..++... .......|.++++++ .+..++.++. ++.++||++
T Consensus 126 ~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~--~i~~~~~V~Slswsp------dG~lLat~s~-D~~IrIwD~ 196 (568)
T PTZ00420 126 KKISIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAF--QINMPKKLSSLKWNI------KGNLLSGTCV-GKHMHIIDP 196 (568)
T ss_pred CcEEEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEE--EEecCCcEEEEEECC------CCCEEEEEec-CCEEEEEEC
Confidence 3577777663 34443 4457788887876643221 123346788998865 2557777766 999999999
Q ss_pred CCCCeeE
Q 001655 514 PDLNLIT 520 (1036)
Q Consensus 514 ~~l~~v~ 520 (1036)
.+.+.+.
T Consensus 197 Rsg~~i~ 203 (568)
T PTZ00420 197 RKQEIAS 203 (568)
T ss_pred CCCcEEE
Confidence 8866654
No 191
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=54.85 E-value=45 Score=40.03 Aligned_cols=114 Identities=14% Similarity=0.136 Sum_probs=68.9
Q ss_pred CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 661 EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 661 ~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
++.+++.+|+....+++..++. ++++++|-...+-..++ +...|. +.-+.|......+++-+
T Consensus 134 Rs~~~ldfh~tep~iliSGSQD---------g~vK~~DlR~~~S~~t~-~~nSES---iRDV~fsp~~~~~F~s~----- 195 (839)
T KOG0269|consen 134 RSANKLDFHSTEPNILISGSQD---------GTVKCWDLRSKKSKSTF-RSNSES---IRDVKFSPGYGNKFASI----- 195 (839)
T ss_pred cceeeeeeccCCccEEEecCCC---------ceEEEEeeecccccccc-cccchh---hhceeeccCCCceEEEe-----
Confidence 4667888988777666665542 78999987544433322 224444 44555544333334322
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCe-EEEEEC--CEEEEEEee
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGK-LLAAIN--QKIQLYKWM 797 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~-Lv~~~g--~~l~v~~~~ 797 (1036)
--+|.+..|++...+.-......+.|||+++.--.++ +++..| +++.+++|.
T Consensus 196 -----~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwhPnr~~lATGGRDK~vkiWd~t 250 (839)
T KOG0269|consen 196 -----HDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWHPNREWLATGGRDKMVKIWDMT 250 (839)
T ss_pred -----cCCceEEEeeccCchhHHHHhhcccCceEEEeecCCCceeeecCCCccEEEEecc
Confidence 1569999999985543333334679999998755444 444444 468887774
No 192
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=54.83 E-value=2e+02 Score=30.00 Aligned_cols=110 Identities=16% Similarity=0.159 Sum_probs=65.0
Q ss_pred CCEEEEEEcCCeEEEEEEcC-cEEEEEEe-ccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCC--CeeEE
Q 001655 446 ASQVLLATGGGHLVYLEIGD-GILTEVKH-AQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDL--NLITK 521 (1036)
Q Consensus 446 ~~~vvv~~~~~~~~~l~~~~-~~l~~~~~-~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l--~~v~~ 521 (1036)
+..++-+.+++.+..|++.+ ++...+.. .--...+.-++... ++.+.+++-+.+ ||.+.|++-.+. +..+.
T Consensus 23 gkrlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wah----Pk~G~iLAScsY-DgkVIiWke~~g~w~k~~e 97 (299)
T KOG1332|consen 23 GKRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAH----PKFGTILASCSY-DGKVIIWKEENGRWTKAYE 97 (299)
T ss_pred cceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecc----cccCcEeeEeec-CceEEEEecCCCchhhhhh
Confidence 44555556677777777755 33222221 11234455555421 234677877777 999999986542 11111
Q ss_pred ecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecC
Q 001655 522 EHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMK 561 (1036)
Q Consensus 522 ~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~ 561 (1036)
.-..+....|+...+-+-...|.|+..||.+-+++++..
T Consensus 98 -~~~h~~SVNsV~wapheygl~LacasSDG~vsvl~~~~~ 136 (299)
T KOG1332|consen 98 -HAAHSASVNSVAWAPHEYGLLLACASSDGKVSVLTYDSS 136 (299)
T ss_pred -hhhhcccceeecccccccceEEEEeeCCCcEEEEEEcCC
Confidence 111123445665555555678999999999999888765
No 193
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=53.63 E-value=99 Score=36.97 Aligned_cols=145 Identities=20% Similarity=0.170 Sum_probs=84.3
Q ss_pred EEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC---eEEEEEEEE
Q 001655 692 HFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG---KLQLIAEKE 768 (1036)
Q Consensus 692 ~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~---kl~~~~~~~ 768 (1036)
+.|.+++-.+.+.. .+.++-.+.++|.+.+. ....+.|.|| .+||+-+|.+.+. .+.++...+
T Consensus 55 G~lyl~~R~~~~~~-~~~~~~~~~~~~~~~vs---~~e~lvAagt----------~~g~V~v~ql~~~~p~~~~~~t~~d 120 (726)
T KOG3621|consen 55 GSVYLYNRHTGEMR-KLKNEGATGITCVRSVS---SVEYLVAAGT----------ASGRVSVFQLNKELPRDLDYVTPCD 120 (726)
T ss_pred ceEEEEecCchhhh-cccccCccceEEEEEec---chhHhhhhhc----------CCceEEeehhhccCCCcceeecccc
Confidence 57777776544322 22333355666665552 2345666676 5799999998842 455666555
Q ss_pred e--cCceeEeccc-cC-eEEEEEC-CEEEEEEeeecCCCccchhcc-cccccceEEEEEEEeCCEEEEEeccccEEEEEE
Q 001655 769 T--KGAVYSLNAF-NG-KLLAAIN-QKIQLYKWMLRDDGTRELQSE-CGHHGHILALYVQTRGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 769 ~--~g~v~~i~~~-~g-~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~-~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~ 842 (1036)
. +-.|+|++=- ++ +++.|-. .+|.+.+++....+ +.+. --+.....++.|+....+++|+++.+++- |
T Consensus 121 ~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s~~~~---~~~~q~il~~ds~IVQlD~~q~~LLVStl~r~~L---c 194 (726)
T KOG3621|consen 121 KSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDSRQAF---LSKSQEILSEDSEIVQLDYLQSYLLVSTLTRCIL---C 194 (726)
T ss_pred ccCCceEEEEEecccccEEeecCCCceEEEEEechhhhh---ccccceeeccCcceEEeecccceehHhhhhhhhe---e
Confidence 5 7789998833 33 4555543 35655555321000 0000 00011234788999999999999999974 3
Q ss_pred eccCCeEEEEeccC
Q 001655 843 KHEEGAIEERARDY 856 (1036)
Q Consensus 843 ~~~~~~l~~~a~D~ 856 (1036)
+.+..++..+++-+
T Consensus 195 ~tE~eti~QIG~k~ 208 (726)
T KOG3621|consen 195 QTEAETITQIGKKP 208 (726)
T ss_pred ecchhHHHHhcCCC
Confidence 55555566666433
No 194
>KOG4328 consensus WD40 protein [Function unknown]
Probab=53.47 E-value=3.9e+02 Score=30.47 Aligned_cols=77 Identities=13% Similarity=0.076 Sum_probs=43.4
Q ss_pred CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCC----CeeEEecCCCccCceeEEeeeecCeEEEEEEeCCC
Q 001655 476 LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDL----NLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDG 551 (1036)
Q Consensus 476 l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l----~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G 551 (1036)
.+..|+|+++.|..+ ...+++|-- .|.|-+|++... .-+.... +.......+.+.+. +...++...-||
T Consensus 185 ~~~Rit~l~fHPt~~----~~lva~GdK-~G~VG~Wn~~~~~~d~d~v~~f~-~hs~~Vs~l~F~P~-n~s~i~ssSyDG 257 (498)
T KOG4328|consen 185 TDRRITSLAFHPTEN----RKLVAVGDK-GGQVGLWNFGTQEKDKDGVYLFT-PHSGPVSGLKFSPA-NTSQIYSSSYDG 257 (498)
T ss_pred cccceEEEEecccCc----ceEEEEccC-CCcEEEEecCCCCCccCceEEec-cCCccccceEecCC-ChhheeeeccCc
Confidence 356789999976432 367888866 899999998421 1121110 00111222322221 345677788899
Q ss_pred cEEEEEEe
Q 001655 552 HLLNFLLN 559 (1036)
Q Consensus 552 ~l~~y~~~ 559 (1036)
.+-.-.+.
T Consensus 258 tiR~~D~~ 265 (498)
T KOG4328|consen 258 TIRLQDFE 265 (498)
T ss_pred eeeeeeec
Confidence 77665554
No 195
>PF08553 VID27: VID27 cytoplasmic protein; InterPro: IPR013863 This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=51.69 E-value=50 Score=40.91 Aligned_cols=88 Identities=17% Similarity=0.173 Sum_probs=60.1
Q ss_pred CCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEecCCeEEEEEeecCeeEEEEeeCCCCCCCcEEEee
Q 001655 212 DGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYLDNAVVYIGSSYGDSQLIKLNLQPDAKGSYVEVLE 291 (1036)
Q Consensus 212 ~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~ 291 (1036)
++..-+++..+-.||++.-...++.+..-......+.+..+|++.-.+|++.+||.-||=.||-= .+ .+-..
T Consensus 541 t~e~tflGls~n~lfriDpR~~~~k~v~~~~k~Y~~~~~Fs~~aTt~~G~iavgs~~G~IRLyd~--~g------~~AKT 612 (794)
T PF08553_consen 541 TNEQTFLGLSDNSLFRIDPRLSGNKLVDSQSKQYSSKNNFSCFATTEDGYIAVGSNKGDIRLYDR--LG------KRAKT 612 (794)
T ss_pred CCCceEEEECCCceEEeccCCCCCceeeccccccccCCCceEEEecCCceEEEEeCCCcEEeecc--cc------hhhhh
Confidence 34667888888899999877665433221222223456778999999999999999999888841 11 12233
Q ss_pred ecccCC-ceeeeEEecc
Q 001655 292 RYVNLG-PIVDFCVVDL 307 (1036)
Q Consensus 292 ~l~n~~-Pi~D~~~~~~ 307 (1036)
.||++| ||+.+.+...
T Consensus 613 ~lp~lG~pI~~iDvt~D 629 (794)
T PF08553_consen 613 ALPGLGDPIIGIDVTAD 629 (794)
T ss_pred cCCCCCCCeeEEEecCC
Confidence 478764 9999988653
No 196
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=51.05 E-value=2.6e+02 Score=31.21 Aligned_cols=146 Identities=16% Similarity=0.193 Sum_probs=85.9
Q ss_pred CCCceEEEEEeeeeCCCCCCCcceEEEEEEEeC-C-eEEEEEEEEecCceeEecccc--CeEEEEEC-CEEEEEE-eeec
Q 001655 726 DDSNVYYCVGTAYVLPEENEPTKGRILVFIVED-G-KLQLIAEKETKGAVYSLNAFN--GKLLAAIN-QKIQLYK-WMLR 799 (1036)
Q Consensus 726 ~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~-~-kl~~~~~~~~~g~v~~i~~~~--g~Lv~~~g-~~l~v~~-~~~~ 799 (1036)
.+..++++|+|+- -+.++|.+.. . ..+++....++-..+++.... -+.+++.+ +.++-++ |+..
T Consensus 71 s~~~~llAv~~~~----------K~~~~f~~~~~~~~~kl~~~~~v~~~~~ai~~~~~~~sv~v~dkagD~~~~di~s~~ 140 (390)
T KOG3914|consen 71 SDSGRLVAVATSS----------KQRAVFDYRENPKGAKLLDVSCVPKRPTAISFIREDTSVLVADKAGDVYSFDILSAD 140 (390)
T ss_pred CCCceEEEEEeCC----------CceEEEEEecCCCcceeeeEeecccCcceeeeeeccceEEEEeecCCceeeeeeccc
Confidence 4568899999852 2445555552 2 377777777777777777652 34444433 3444333 3211
Q ss_pred CCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEecc--CCeEEEEeccCCcceeEEEEEeeCceEEEEcc
Q 001655 800 DDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHE--EGAIEERARDYNANWMSAVEILDDDIYLGAEN 877 (1036)
Q Consensus 800 ~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~--~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~ 877 (1036)
.+ +......+-...+-+.+.-.+.+|+.+|-..=|.+.+|... -.++.+=.++ .|+.....++..++.+-.
T Consensus 141 -~~--~~~~~lGhvSml~dVavS~D~~~IitaDRDEkIRvs~ypa~f~IesfclGH~e----FVS~isl~~~~~LlS~sG 213 (390)
T KOG3914|consen 141 -SG--RCEPILGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESFCLGHKE----FVSTISLTDNYLLLSGSG 213 (390)
T ss_pred -cc--CcchhhhhhhhhheeeecCCCCEEEEecCCceEEEEecCcccchhhhccccHh----heeeeeeccCceeeecCC
Confidence 12 22222222223334445556679999999999998887531 1222222333 455566667667788888
Q ss_pred CCcEEEEeeCC
Q 001655 878 NFNLFTVRKNS 888 (1036)
Q Consensus 878 ~gnl~~l~~~~ 888 (1036)
+++++...+..
T Consensus 214 D~tlr~Wd~~s 224 (390)
T KOG3914|consen 214 DKTLRLWDITS 224 (390)
T ss_pred CCcEEEEeccc
Confidence 99999998854
No 197
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=51.04 E-value=3.8e+02 Score=29.67 Aligned_cols=30 Identities=7% Similarity=0.171 Sum_probs=24.0
Q ss_pred eeEEEEEeeCceEEEEccCCcEEEEeeCCC
Q 001655 860 WMSAVEILDDDIYLGAENNFNLFTVRKNSE 889 (1036)
Q Consensus 860 ~~~~~~~l~~~~~l~~D~~gnl~~l~~~~~ 889 (1036)
-+.+++|+++-+++.+-.+-||++.+.+..
T Consensus 295 T~KS~~F~~D~~v~tGSD~~~i~~WklP~~ 324 (609)
T KOG4227|consen 295 TIKSMTFIDDYTVATGSDHWGIHIWKLPRA 324 (609)
T ss_pred eeeeeeeecceeeeccCcccceEEEecCCC
Confidence 345889998878888778899999998743
No 198
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=50.62 E-value=3.7e+02 Score=31.49 Aligned_cols=234 Identities=18% Similarity=0.174 Sum_probs=105.6
Q ss_pred CCeEEEEEeecCeeEEEEeeCCCCCCCcEEEeeeccc-CCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecC----
Q 001655 259 NAVVYIGSSYGDSQLIKLNLQPDAKGSYVEVLERYVN-LGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNG---- 333 (1036)
Q Consensus 259 ~~~lF~gS~~gds~l~~~~~~~~~~~~~~~~~~~l~n-~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~g---- 333 (1036)
...|+.+|..|-=.+|++....+....-++.+-++.+ -|||+..++.... . .+-+| |-+|+|+-..--
T Consensus 306 ep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfraH~gPVl~v~v~~n~----~--~~ysg-g~Dg~I~~w~~p~n~d 378 (577)
T KOG0642|consen 306 EPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFRAHEGPVLCVVVPSNG----E--HCYSG-GIDGTIRCWNLPPNQD 378 (577)
T ss_pred CCeEEEeccccchhhhhhcccCCccccceeeeEEEecccCceEEEEecCCc----e--EEEee-ccCceeeeeccCCCCC
Confidence 4578888888776677774322222222556666655 4999988876532 2 23344 556777765221
Q ss_pred ----CceeEEEeeeCCCc-ceEEEeecCCCCCcccEEEEEecCceE-EEEecCCCC--eeeeeecCe------eccccce
Q 001655 334 ----IGINEQASVELQGI-KGMWSLRSSTDDPFDTFLVVSFISETR-ILAMNLEDE--LEETEIEGF------CSQTQTL 399 (1036)
Q Consensus 334 ----i~~~~~~~~~l~~~-~~iw~l~~~~~~~~~~~lv~S~~~~T~-vl~~~~~~~--~~e~~~~~f------~~~~~Tl 399 (1036)
..+..+.. .+-|. ..+|.+-.+. ..+..+.+|+ +.|. .+...+... +.+..+.++ ....+.+
T Consensus 379 p~ds~dp~vl~~-~l~Ghtdavw~l~~s~--~~~~Llscs~-DgTvr~w~~~~~~~~~f~~~~e~g~Plsvd~~ss~~a~ 454 (577)
T KOG0642|consen 379 PDDSYDPSVLSG-TLLGHTDAVWLLALSS--TKDRLLSCSS-DGTVRLWEPTEESPCTFGEPKEHGYPLSVDRTSSRPAH 454 (577)
T ss_pred cccccCcchhcc-ceeccccceeeeeecc--cccceeeecC-CceEEeeccCCcCccccCCccccCCcceEeeccchhHh
Confidence 11211111 23343 3789887643 2222223333 3343 332222111 111111121 1111111
Q ss_pred eeeecCC---CeEEEEecCcEEEEecCCccceeeeeCCCCCcEEEEE-eCCCEEEEEEcCCeEEEEEEcCcEEEEEEecc
Q 001655 400 FCHDAIY---NQLVQVTSGSVRLVSSTSRELRNEWKSPPGYSVNVAT-ANASQVLLATGGGHLVYLEIGDGILTEVKHAQ 475 (1036)
Q Consensus 400 ~~~~~~~---~~~vQVt~~~i~l~~~~~~~~~~~w~~~~~~~I~~as-~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~ 475 (1036)
....... ...=|.+...++++.......... ....+...+ -+.+..+.+..+..+.+++...+++..-....
T Consensus 455 ~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~----~~~in~vVs~~~~~~~~~~hed~~Ir~~dn~~~~~l~s~~a~ 530 (577)
T KOG0642|consen 455 SLASFRFGYTSIDDMEVVSDLLIFESSASPGPRR----YPQINKVVSHPTADITFTAHEDRSIRFFDNKTGKILHSMVAH 530 (577)
T ss_pred hhhhcccccccchhhhhhhheeeccccCCCcccc----cCccceEEecCCCCeeEecccCCceecccccccccchheeec
Confidence 1111100 011122222333322211000000 001111222 22455555666677777665444433222111
Q ss_pred CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 476 LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 476 l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
. ..++|+++.+ .+.++..|.- ++++.++++..
T Consensus 531 ~-~svtslai~~------ng~~l~s~s~-d~sv~l~kld~ 562 (577)
T KOG0642|consen 531 K-DSVTSLAIDP------NGPYLMSGSH-DGSVRLWKLDV 562 (577)
T ss_pred c-ceecceeecC------CCceEEeecC-Cceeehhhccc
Confidence 1 3467888854 3678888877 99999998754
No 199
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=50.29 E-value=1.8e+02 Score=34.76 Aligned_cols=153 Identities=10% Similarity=0.001 Sum_probs=76.6
Q ss_pred EEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC--eE----EEE-EEEEecCceeEec--cccCeEEEEEC
Q 001655 718 SILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG--KL----QLI-AEKETKGAVYSLN--AFNGKLLAAIN 788 (1036)
Q Consensus 718 si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~--kl----~~~-~~~~~~g~v~~i~--~~~g~Lv~~~g 788 (1036)
+...++|.......++|||- .|.|+.-.-.+. .. +.+ +-.-..|+|+++. +|...++.++|
T Consensus 349 ~~t~~~F~~~~p~~FiVGTe----------~G~v~~~~r~g~~~~~~~~~~~~~~~~~h~g~v~~v~~nPF~~k~fls~g 418 (555)
T KOG1587|consen 349 GATSLKFEPTDPNHFIVGTE----------EGKVYKGCRKGYTPAPEVSYKGHSTFITHIGPVYAVSRNPFYPKNFLSVG 418 (555)
T ss_pred ceeeEeeccCCCceEEEEcC----------CcEEEEEeccCCcccccccccccccccccCcceEeeecCCCccceeeeec
Confidence 34445555555677999993 355554221111 11 222 2234578999986 34444444444
Q ss_pred -CEEEEEEeeecCCCccchhcccccccc-eEEEEEEEe--C-CEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEE
Q 001655 789 -QKIQLYKWMLRDDGTRELQSECGHHGH-ILALYVQTR--G-DFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSA 863 (1036)
Q Consensus 789 -~~l~v~~~~~~~~~~~~L~~~~~~~~~-~~~~~l~~~--~-~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~ 863 (1036)
-+++++. +.- .-.+.-.++.. .+..++.+. . -..+++|.+--+.+. |-..+...++++......+..
T Consensus 419 DW~vriWs--~~~----~~~Pl~~~~~~~~~v~~vaWSptrpavF~~~d~~G~l~iW--DLl~~~~~Pv~s~~~~~~~l~ 490 (555)
T KOG1587|consen 419 DWTVRIWS--EDV----IASPLLSLDSSPDYVTDVAWSPTRPAVFATVDGDGNLDIW--DLLQDDEEPVLSQKVCSPALT 490 (555)
T ss_pred cceeEecc--ccC----CCCcchhhhhccceeeeeEEcCcCceEEEEEcCCCceehh--hhhccccCCcccccccccccc
Confidence 5666644 220 01111111111 123344432 2 245566766666553 433334444444433333333
Q ss_pred EEEeeC-c-eEEEEccCCcEEEEeeCC
Q 001655 864 VEILDD-D-IYLGAENNFNLFTVRKNS 888 (1036)
Q Consensus 864 ~~~l~~-~-~~l~~D~~gnl~~l~~~~ 888 (1036)
..+-.. + .+.++|..|++++++.++
T Consensus 491 ~~~~s~~g~~lavGd~~G~~~~~~l~~ 517 (555)
T KOG1587|consen 491 RVRWSPNGKLLAVGDANGTTHILKLSE 517 (555)
T ss_pred eeecCCCCcEEEEecCCCcEEEEEcCc
Confidence 444444 3 367899999999999864
No 200
>PF14779 BBS1: Ciliary BBSome complex subunit 1
Probab=50.11 E-value=47 Score=35.11 Aligned_cols=201 Identities=14% Similarity=0.141 Sum_probs=105.7
Q ss_pred eEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cC------eEEEEEC
Q 001655 717 CSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NG------KLLAAIN 788 (1036)
Q Consensus 717 ~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g------~Lv~~~g 788 (1036)
.||...-+..++..-++||..-. ....=+|.+|+ -..+.++....+.+.+|+.| +. -|.+|.|
T Consensus 18 sC~~l~Dl~gDGd~kLvvaD~g~-----~~~~~kLKVyk----Gt~l~~E~~L~d~P~ai~sFy~d~~ep~~P~iAVA~G 88 (257)
T PF14779_consen 18 SCMALADLQGDGDYKLVVADLGT-----GDQNMKLKVYK----GTSLISEITLPDLPSAIVSFYMDEHEPRTPAIAVAAG 88 (257)
T ss_pred ceeEeeecCCCCeEEEEEEecCC-----cCCCceEEEEc----CCChhhcccccCCCeEEEEEeccCCCCCCCeEEEEeC
Confidence 46666666777788888887421 11223888883 35567778889999999988 12 2899999
Q ss_pred CEEEEEEe-------eec--CCCccc---hhcc--cccccceEE---EEEEEeCCEEEEEeccccEEEEEEeccCC-eEE
Q 001655 789 QKIQLYKW-------MLR--DDGTRE---LQSE--CGHHGHILA---LYVQTRGDFIVVGDLMKSISLLIYKHEEG-AIE 850 (1036)
Q Consensus 789 ~~l~v~~~-------~~~--~~~~~~---L~~~--~~~~~~~~~---~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~-~l~ 850 (1036)
+.|++|+= ... +....+ |... ...+..... -+++-.++ +-=..+|..|+..++++. .+.
T Consensus 89 ~~vyiYkNlkP~yKftlP~~~~~~~E~eiW~~~~~~~i~~~~l~~~L~~lr~~~~---~~LS~rSl~~L~l~~ee~~~fi 165 (257)
T PF14779_consen 89 PSVYIYKNLKPFYKFTLPPLEINPLEQEIWQQLREGKIDPETLKEMLESLRDIAG---VKLSPRSLRFLQLDPEEREAFI 165 (257)
T ss_pred CEEEEEecccceeeecCCCCCCCHHHHHHHHhcccCCCCHHHHHHHHHHHhhccC---CccCHHHHHHHCCCHHHHHHHH
Confidence 99999861 100 000000 0000 000000000 00111000 001234444444433221 222
Q ss_pred EEeccC---CcceeEEEEEeeC-----c---eEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccceEEe-ee
Q 001655 851 ERARDY---NANWMSAVEILDD-----D---IYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVNRFRH-GS 918 (1036)
Q Consensus 851 ~~a~D~---~~~~~~~~~~l~~-----~---~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~~~~~-~~ 918 (1036)
...++. ..-.+||+.-|-. + ..+.+-.+|.+++++-. -+....++.+++....+.- |.
T Consensus 166 ~~~k~~pl~~~t~ITcm~tikk~~~d~~a~scLViGTE~~~i~iLd~~----------af~il~~~~lpsvPv~i~~~G~ 235 (257)
T PF14779_consen 166 ERYKDSPLKRQTVITCMATIKKSSADEDAVSCLVIGTESGEIYILDPQ----------AFTILKQVQLPSVPVFISVSGQ 235 (257)
T ss_pred HHHhcCCcccCceeEEeeeecccccCCCCcceEEEEecCCeEEEECch----------hheeEEEEecCCCceEEEEEee
Confidence 222221 1224556655522 1 24555578999988732 3456677888877765542 33
Q ss_pred eeecCCCCCCCCcceEEEEccccceEEEE
Q 001655 919 LVMRLPDSDVGQIPTVIFGTVNGVIGVIA 947 (1036)
Q Consensus 919 l~~~~~~~~~~~~~~il~~t~~GsIg~l~ 947 (1036)
+. .....|+.+|-+|.||.+.
T Consensus 236 ~d--------evdyRI~Va~Rdg~iy~ir 256 (257)
T PF14779_consen 236 YD--------EVDYRIVVACRDGKIYTIR 256 (257)
T ss_pred ee--------ccceEEEEEeCCCEEEEEe
Confidence 21 1346899999999999874
No 201
>PHA03098 kelch-like protein; Provisional
Probab=50.10 E-value=1.6e+02 Score=35.36 Aligned_cols=132 Identities=12% Similarity=0.098 Sum_probs=66.9
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECC-------EEEEEEeeecCC
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQ-------KIQLYKWMLRDD 801 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~-------~l~v~~~~~~~~ 801 (1036)
...+++|.... .......++.|+...++.+.+.....+-.-.+++.++|+|++.-|. .+..|+ ..+
T Consensus 295 ~~lyv~GG~~~----~~~~~~~v~~yd~~~~~W~~~~~~~~~R~~~~~~~~~~~lyv~GG~~~~~~~~~v~~yd--~~~- 367 (534)
T PHA03098 295 NVIYFIGGMNK----NNLSVNSVVSYDTKTKSWNKVPELIYPRKNPGVTVFNNRIYVIGGIYNSISLNTVESWK--PGE- 367 (534)
T ss_pred CEEEEECCCcC----CCCeeccEEEEeCCCCeeeECCCCCcccccceEEEECCEEEEEeCCCCCEecceEEEEc--CCC-
Confidence 46777775321 1123346788888777776554333222223455567887766553 233443 221
Q ss_pred CccchhcccccccceEEEEEEEeCCEEEE-Eeccc----cEEEEEEeccCCeEEEEeccCCcceeEEEEEeeC
Q 001655 802 GTRELQSECGHHGHILALYVQTRGDFIVV-GDLMK----SISLLIYKHEEGAIEERARDYNANWMSAVEILDD 869 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~~----Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~ 869 (1036)
.. +...+....+-...+..+.++.|++ |-... .=.+..|++..++...++.-+.++...++...++
T Consensus 368 ~~--W~~~~~lp~~r~~~~~~~~~~~iYv~GG~~~~~~~~~~v~~yd~~t~~W~~~~~~p~~r~~~~~~~~~~ 438 (534)
T PHA03098 368 SK--WREEPPLIFPRYNPCVVNVNNLIYVIGGISKNDELLKTVECFSLNTNKWSKGSPLPISHYGGCAIYHDG 438 (534)
T ss_pred Cc--eeeCCCcCcCCccceEEEECCEEEEECCcCCCCcccceEEEEeCCCCeeeecCCCCccccCceEEEECC
Confidence 22 3222222222122234456776665 32111 1235678888888887776566665544444443
No 202
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=48.89 E-value=3.4e+02 Score=28.50 Aligned_cols=77 Identities=19% Similarity=0.292 Sum_probs=42.5
Q ss_pred cCeeEEEEeeCCCCCCCcEEEeeecccCCceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecCCceeEEEeeeCCCcc
Q 001655 269 GDSQLIKLNLQPDAKGSYVEVLERYVNLGPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNGIGINEQASVELQGIK 348 (1036)
Q Consensus 269 gds~l~~~~~~~~~~~~~~~~~~~l~n~~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~~~l~~~~ 348 (1036)
|++.|+-++..+ +.-+.++.++.----+.|.+=-+. .+.++++||| +|+|++.--+.+...+..++ .-.+
T Consensus 36 G~G~L~ile~~~---~~gi~e~~s~d~~D~LfdV~Wse~---~e~~~~~a~G---DGSLrl~d~~~~s~Pi~~~k-EH~~ 105 (311)
T KOG0277|consen 36 GNGRLFILEVTD---PKGIQECQSYDTEDGLFDVAWSEN---HENQVIAASG---DGSLRLFDLTMPSKPIHKFK-EHKR 105 (311)
T ss_pred cCceEEEEecCC---CCCeEEEEeeecccceeEeeecCC---CcceEEEEec---CceEEEeccCCCCcchhHHH-hhhh
Confidence 445555554421 111566666664455666665442 4578999999 57888888665555443321 1223
Q ss_pred eEEEeec
Q 001655 349 GMWSLRS 355 (1036)
Q Consensus 349 ~iw~l~~ 355 (1036)
.++++..
T Consensus 106 EV~Svdw 112 (311)
T KOG0277|consen 106 EVYSVDW 112 (311)
T ss_pred heEEecc
Confidence 4555543
No 203
>PF00400 WD40: WD domain, G-beta repeat; InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=48.33 E-value=35 Score=23.65 Aligned_cols=30 Identities=20% Similarity=0.323 Sum_probs=23.6
Q ss_pred CCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEE
Q 001655 476 LEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFS 512 (1036)
Q Consensus 476 l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~ 512 (1036)
-...|.|+++.+ ...+++.|.. |+.|.+|+
T Consensus 10 h~~~i~~i~~~~------~~~~~~s~~~-D~~i~vwd 39 (39)
T PF00400_consen 10 HSSSINSIAWSP------DGNFLASGSS-DGTIRVWD 39 (39)
T ss_dssp SSSSEEEEEEET------TSSEEEEEET-TSEEEEEE
T ss_pred CCCcEEEEEEec------ccccceeeCC-CCEEEEEC
Confidence 346789999865 2578888888 99999985
No 204
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=47.59 E-value=49 Score=40.13 Aligned_cols=119 Identities=18% Similarity=0.150 Sum_probs=71.0
Q ss_pred EEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCce--eEeccccCeEE
Q 001655 707 TYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAV--YSLNAFNGKLL 784 (1036)
Q Consensus 707 ~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v--~~i~~~~g~Lv 784 (1036)
.++|.....+.++.+|.- ..++++|..--. ...|.+-+|-=. +. ...++.-|| +++|=...+++
T Consensus 8 kIE~~Dsdavsti~SWHP---sePlfAVA~fS~------er~GSVtIfadt-GE----Pqr~Vt~P~hatSLCWHpe~~v 73 (1416)
T KOG3617|consen 8 KIEFLDSDAVSTISSWHP---SEPLFAVASFSP------ERGGSVTIFADT-GE----PQRDVTYPVHATSLCWHPEEFV 73 (1416)
T ss_pred eeecccccccccccccCC---CCceeEEEEecC------CCCceEEEEecC-CC----CCcccccceehhhhccChHHHH
Confidence 457777777788888853 378999986422 256777777322 11 223333444 45664456677
Q ss_pred EEECCE---EEEEEeeecCCCccchhcc-cccccceEEEEEEEeCCEEEEEeccccEEEEEEec
Q 001655 785 AAINQK---IQLYKWMLRDDGTRELQSE-CGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 785 ~~~g~~---l~v~~~~~~~~~~~~L~~~-~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~ 844 (1036)
.++|-. +.++. .+.++.... ..+..+...+.-+-.|+.++.+|.+.++.+++|+.
T Consensus 74 La~gwe~g~~~v~~-----~~~~e~htv~~th~a~i~~l~wS~~G~~l~t~d~~g~v~lwr~d~ 132 (1416)
T KOG3617|consen 74 LAQGWEMGVSDVQK-----TNTTETHTVVETHPAPIQGLDWSHDGTVLMTLDNPGSVHLWRYDV 132 (1416)
T ss_pred HhhccccceeEEEe-----cCCceeeeeccCCCCCceeEEecCCCCeEEEcCCCceeEEEEeee
Confidence 777632 23332 123333332 23333334445555799999999999999999984
No 205
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=46.43 E-value=5.9e+02 Score=30.52 Aligned_cols=180 Identities=13% Similarity=0.103 Sum_probs=98.6
Q ss_pred cEEEEEecCceE-EEEecCCCCeeeeeecCeeccccceeeeecCCCeEEEEe-cCcEEEEecCCccceeeeeCCCCCcEE
Q 001655 363 TFLVVSFISETR-ILAMNLEDELEETEIEGFCSQTQTLFCHDAIYNQLVQVT-SGSVRLVSSTSRELRNEWKSPPGYSVN 440 (1036)
Q Consensus 363 ~~lv~S~~~~T~-vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt-~~~i~l~~~~~~~~~~~w~~~~~~~I~ 440 (1036)
.+++....++|. ++..... ........|-.-...+++... +++.++=.. ...+|+.+..+++...... ....+.
T Consensus 219 ~~~~~~s~~~tl~~~~~~~~-~~i~~~l~GH~g~V~~l~~~~-~~~~lvsgS~D~t~rvWd~~sg~C~~~l~--gh~stv 294 (537)
T KOG0274|consen 219 GFFKSGSDDSTLHLWDLNNG-YLILTRLVGHFGGVWGLAFPS-GGDKLVSGSTDKTERVWDCSTGECTHSLQ--GHTSSV 294 (537)
T ss_pred CeEEecCCCceeEEeecccc-eEEEeeccCCCCCceeEEEec-CCCEEEEEecCCcEEeEecCCCcEEEEec--CCCceE
Confidence 455566666666 4444332 111122344444445555443 244444443 6677877766655554432 122333
Q ss_pred EEEeCCCEEEEE-EcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCee
Q 001655 441 VATANASQVLLA-TGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLI 519 (1036)
Q Consensus 441 ~as~~~~~vvv~-~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v 519 (1036)
.+-......+++ ..++.+...++.++....+..- -...|.|+.+. ...++.|+. +++|.+|+...++.+
T Consensus 295 ~~~~~~~~~~~sgs~D~tVkVW~v~n~~~l~l~~~-h~~~V~~v~~~--------~~~lvsgs~-d~~v~VW~~~~~~cl 364 (537)
T KOG0274|consen 295 RCLTIDPFLLVSGSRDNTVKVWDVTNGACLNLLRG-HTGPVNCVQLD--------EPLLVSGSY-DGTVKVWDPRTGKCL 364 (537)
T ss_pred EEEEccCceEeeccCCceEEEEeccCcceEEEecc-ccccEEEEEec--------CCEEEEEec-CceEEEEEhhhceee
Confidence 333333444444 3466666667776655444322 44678888873 578888988 899999998866654
Q ss_pred EEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEec
Q 001655 520 TKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 520 ~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
..-.- ...-..++.+ +...+++-|.-|+.+..+.+..
T Consensus 365 ~sl~g-H~~~V~sl~~---~~~~~~~Sgs~D~~IkvWdl~~ 401 (537)
T KOG0274|consen 365 KSLSG-HTGRVYSLIV---DSENRLLSGSLDTTIKVWDLRT 401 (537)
T ss_pred eeecC-CcceEEEEEe---cCcceEEeeeeccceEeecCCc
Confidence 42111 1112233322 2227788888888888776653
No 206
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=45.86 E-value=1.6e+02 Score=34.79 Aligned_cols=70 Identities=17% Similarity=0.163 Sum_probs=44.7
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-c-CeEEEEECCEEEEEEeeecCCCccch
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-N-GKLLAAINQKIQLYKWMLRDDGTREL 806 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~-g~Lv~~~g~~l~v~~~~~~~~~~~~L 806 (1036)
+..++|=|+..- =.++.+.-..-++.......|-++|-|=- + .+|++|+|+.++-|-|+. .++.|
T Consensus 124 ~~iL~VLT~~dv----------SV~~sV~~d~srVkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyiWd~---~qKtL 190 (671)
T PF15390_consen 124 KAILTVLTARDV----------SVLPSVHCDSSRVKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYIWDS---AQKTL 190 (671)
T ss_pred CceEEEEecCce----------eEeeeeeeCCceEEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEEecC---chhhh
Confidence 678888886421 13344442233344455778888877744 3 489999999999999963 34556
Q ss_pred hcccc
Q 001655 807 QSECG 811 (1036)
Q Consensus 807 ~~~~~ 811 (1036)
.+..+
T Consensus 191 ~~Csf 195 (671)
T PF15390_consen 191 HRCSF 195 (671)
T ss_pred hhCCc
Confidence 55433
No 207
>PF02978 SRP_SPB: Signal peptide binding domain; InterPro: IPR004125 The signal recognition particle (SRP) is a multimeric protein, which along with its conjugate receptor (SR), is involved in targeting secretory proteins to the rough endoplasmic reticulum (RER) membrane in eukaryotes, or to the plasma membrane in prokaryotes [, ]. SRP recognises the signal sequence of the nascent polypeptide on the ribosome, retards its elongation, and docks the SRP-ribosome-polypeptide complex to the RER membrane via the SR receptor. Eukaryotic SRP consists of six polypeptides (SRP9, SRP14, SRP19, SRP54, SRP68 and SRP72) and a single 300 nucleotide 7S RNA molecule. The RNA component catalyses the interaction of SRP with its SR receptor []. In higher eukaryotes, the SRP complex consists of the Alu domain and the S domain linked by the SRP RNA. The Alu domain consists of a heterodimer of SRP9 and SRP14 bound to the 5' and 3' terminal sequences of SRP RNA. This domain is necessary for retarding the elongation of the nascent polypeptide chain, which gives SRP time to dock the ribosome-polypeptide complex to the RER membrane. In archaea, the SRP complex contains 7S RNA like its eukaryotic counterpart, yet only includes two of the six protein subunits found in the eukarytic complex: SRP19 and SRP54 []. This entry represents the M domain of the 54 kDa SRP54 component, a GTP-binding protein that interacts with the signal sequence when it emerges from the ribosome. SRP54 of the signal recognition particle has a three-domain structure: an N-terminal helical bundle domain, a GTPase domain, and the M-domain that binds the 7s RNA and also binds the signal sequence. The extreme C-terminal region is glycine-rich and lower in complexity and poorly conserved between species. These proteins include Escherichia coli and Bacillus subtilis ffh protein (P48), which seems to be the prokaryotic counterpart of SRP54; signal recognition particle receptor alpha subunit (docking protein), an integral membrane GTP-binding protein which ensures, in conjunction with SRP, the correct targeting of nascent secretory proteins to the endoplasmic reticulum membrane; bacterial FtsY protein, which is believed to play a similar role to that of the docking protein in eukaryotes; the pilA protein from Neisseria gonorrhoeae, the homologue of ftsY; and bacterial flagellar biosynthesis protein flhF.; GO: 0008312 7S RNA binding, 0006614 SRP-dependent cotranslational protein targeting to membrane, 0048500 signal recognition particle; PDB: 2FFH_B 3NDB_B 2V3C_C 1QZW_G 1QZX_B 3KL4_A 2JQE_A 1HQ1_A 1RY1_W 1MFQ_C ....
Probab=45.70 E-value=31 Score=30.98 Aligned_cols=29 Identities=14% Similarity=0.368 Sum_probs=24.5
Q ss_pred CHHHHHHHHHhcCCCHHHHHHHHHHHhcc
Q 001655 1007 SRTRMDEISKTMNVSVEELCKRVEELTRL 1035 (1036)
Q Consensus 1007 ~~~~q~~i~~~~~~~~~~i~~~l~~l~~~ 1035 (1036)
..+.+.+||++.|++++|+.++|.+.+.+
T Consensus 72 ~~sR~~RIA~GSG~~~~eV~~ll~~f~~~ 100 (104)
T PF02978_consen 72 NESRRRRIARGSGTTVQEVNELLKQFKQM 100 (104)
T ss_dssp HHHHHHHHHHHTTS-HHHHHHHHHHHHHH
T ss_pred chHHHHHHHHHcCCCHHHHHHHHHHHHHH
Confidence 34899999999999999999999987754
No 208
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=44.17 E-value=69 Score=39.05 Aligned_cols=63 Identities=13% Similarity=0.234 Sum_probs=49.0
Q ss_pred CCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCc-------eEEEEccCCcEEEEeeC
Q 001655 825 GDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDD-------IYLGAENNFNLFTVRKN 887 (1036)
Q Consensus 825 ~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~-------~~l~~D~~gnl~~l~~~ 887 (1036)
-++|+|++=..+|+++.|...+.+............+=++.|++++ .++++|-.|++++++..
T Consensus 177 ~rlIAVSsNs~~VTVFaf~l~~~r~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~v~~~~I~ 246 (717)
T PF08728_consen 177 SRLIAVSSNSQEVTVFAFALVDERFYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVATDISGEVWTFKIK 246 (717)
T ss_pred ceEEEEecCCceEEEEEEeccccccccccccccccCCCeeEeecCCCCCccceEEEEEeccCcEEEEEEE
Confidence 4689999999999999998765555444333456677789999764 46789999999999883
No 209
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=43.92 E-value=5.6e+02 Score=31.38 Aligned_cols=166 Identities=15% Similarity=0.118 Sum_probs=80.6
Q ss_pred cccEEEEEEecCCEEEEEECCCC---Ce--eEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccc
Q 001655 494 YSQIAAVGMWTDISVRIFSLPDL---NL--ITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDR 568 (1036)
Q Consensus 494 ~~~~~~vg~w~~~~i~i~~l~~l---~~--v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~ 568 (1036)
.+++++.+.. +|.|.+|+|... .. ++.++-. ..+.+.+...+ ..+|+-|..||.+-.|.+......-++.
T Consensus 99 ~~NlIAT~s~-nG~i~vWdlnk~~rnk~l~~f~EH~R---s~~~ldfh~te-p~iliSGSQDg~vK~~DlR~~~S~~t~~ 173 (839)
T KOG0269|consen 99 YSNLIATCST-NGVISVWDLNKSIRNKLLTVFNEHER---SANKLDFHSTE-PNILISGSQDGTVKCWDLRSKKSKSTFR 173 (839)
T ss_pred hhhhheeecC-CCcEEEEecCccccchhhhHhhhhcc---ceeeeeeccCC-ccEEEecCCCceEEEEeeeccccccccc
Confidence 4566666555 899999998652 11 2222221 22333333332 3567779999999999987543211100
Q ss_pred eeeecCccceEEEEEEeCCceEEEEEc-CCceEEEec--CCcEEEeeec-cccceeeecccCCCCCCeEEEEe---CCeE
Q 001655 569 KKVSLGTQPITLRTFSSKNTTHVFAAS-DRPTVIYSS--NKKLLYSNVN-LKEVSHMCPFNSAAFPDSLAIAK---EGEL 641 (1036)
Q Consensus 569 ~~~~lG~~pv~l~~~~~~~~~~v~~~~-~~p~~i~~~--~~~~~~~~~~-~~~i~~~~~f~~~~~~~~l~~~~---~~~l 641 (1036)
. -+-..+-|++.+ +....|+.+ +.-++..++ +++.-+..++ .......+.++ |+.-.+++ ++.+
T Consensus 174 ~-nSESiRDV~fsp----~~~~~F~s~~dsG~lqlWDlRqp~r~~~k~~AH~GpV~c~nwh----Pnr~~lATGGRDK~v 244 (839)
T KOG0269|consen 174 S-NSESIRDVKFSP----GYGNKFASIHDSGYLQLWDLRQPDRCEKKLTAHNGPVLCLNWH----PNREWLATGGRDKMV 244 (839)
T ss_pred c-cchhhhceeecc----CCCceEEEecCCceEEEeeccCchhHHHHhhcccCceEEEeec----CCCceeeecCCCccE
Confidence 0 000111233322 223344433 333333333 1211111111 01122233333 45444454 4556
Q ss_pred EEEEEcCCCCeEEEEEeCCCccceEEEecCCC
Q 001655 642 TIGTIDDIQKLHIRSIPLGEHPRRICHQEQSR 673 (1036)
Q Consensus 642 ~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~ 673 (1036)
+|=.+........-.|.......|+.+-|+..
T Consensus 245 kiWd~t~~~~~~~~tInTiapv~rVkWRP~~~ 276 (839)
T KOG0269|consen 245 KIWDMTDSRAKPKHTINTIAPVGRVKWRPARS 276 (839)
T ss_pred EEEeccCCCccceeEEeecceeeeeeeccCcc
Confidence 66666655555566677777778888877655
No 210
>PF15390 DUF4613: Domain of unknown function (DUF4613)
Probab=43.50 E-value=3e+02 Score=32.68 Aligned_cols=74 Identities=16% Similarity=0.191 Sum_probs=54.7
Q ss_pred EEEEEeCCC--ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEe--CCCceEEEEEECCCCCeEeEEEEEEEcCCC
Q 001655 653 HIRSIPLGE--HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLD--DQTFEFISTYPLDTFEYGCSILSCSFSDDS 728 (1036)
Q Consensus 653 ~~~~i~l~~--tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d--~~t~~~i~~~~~~~~E~v~si~~~~l~~~~ 728 (1036)
..||+.+.+ .|.-|+|++..++.+|++.- -..|.++. +.++--+..+.++.+|++-.+|.. .++
T Consensus 329 ~trKV~IPGILvPDliAfn~kaq~VAVASNT---------cn~ilVYSv~~s~mPniQqIqLe~~ERPKGiCFl---tdk 396 (671)
T PF15390_consen 329 TTRKVSIPGILVPDLIAFNPKAQVVAVASNT---------CNIILVYSVTPSSMPNIQQIQLESNERPKGICFL---TDK 396 (671)
T ss_pred EeeeeccccccccceeeeCCcCCEEEEEecC---------CcEEEEEEeccccCCCeeEEEcccCCCCceeeEc---cCC
Confidence 568888876 89999999999999999753 13444543 466777889999999999887654 334
Q ss_pred ceEEEEEeee
Q 001655 729 NVYYCVGTAY 738 (1036)
Q Consensus 729 ~~~i~VGT~~ 738 (1036)
-=+|.||--.
T Consensus 397 lLLilVGkqK 406 (671)
T PF15390_consen 397 LLLILVGKQK 406 (671)
T ss_pred eEEEEecccc
Confidence 5567777543
No 211
>PF14783 BBS2_Mid: Ciliary BBSome complex subunit 2, middle region
Probab=43.48 E-value=2.6e+02 Score=25.48 Aligned_cols=91 Identities=11% Similarity=0.150 Sum_probs=53.0
Q ss_pred CEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCC
Q 001655 447 SQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGG 526 (1036)
Q Consensus 447 ~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~ 526 (1036)
+-++++.++..|..|+-++ -+.++ +....|++|.-.. ...++.++- +|+|-+|.- .+-++...-
T Consensus 16 ~eLlvGs~D~~IRvf~~~e-~~~Ei---~e~~~v~~L~~~~-------~~~F~Y~l~-NGTVGvY~~--~~RlWRiKS-- 79 (111)
T PF14783_consen 16 NELLVGSDDFEIRVFKGDE-IVAEI---TETDKVTSLCSLG-------GGRFAYALA-NGTVGVYDR--SQRLWRIKS-- 79 (111)
T ss_pred ceEEEecCCcEEEEEeCCc-EEEEE---ecccceEEEEEcC-------CCEEEEEec-CCEEEEEeC--cceeeeecc--
Confidence 4677777777777765432 22222 3345566764321 345666767 899999863 233332211
Q ss_pred ccCceeEEeeeec--CeEEEEEEeCCCcE
Q 001655 527 EIIPRSVLLCAFE--GISYLLCALGDGHL 553 (1036)
Q Consensus 527 ~~~p~si~~~~~~--~~~~L~vgl~~G~l 553 (1036)
...|.++....+. +.+.|++|=.||.+
T Consensus 80 K~~~~~~~~~D~~gdG~~eLI~GwsnGkv 108 (111)
T PF14783_consen 80 KNQVTSMAFYDINGDGVPELIVGWSNGKV 108 (111)
T ss_pred CCCeEEEEEEcCCCCCceEEEEEecCCeE
Confidence 1235566555443 56789999999976
No 212
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=43.27 E-value=4e+02 Score=29.04 Aligned_cols=111 Identities=20% Similarity=0.308 Sum_probs=63.3
Q ss_pred EEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCC-eEEEEEEEEecCceeEec--cccCeEEEEECCEEEEEEeee
Q 001655 722 CSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDG-KLQLIAEKETKGAVYSLN--AFNGKLLAAINQKIQLYKWML 798 (1036)
Q Consensus 722 ~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~-kl~~~~~~~~~g~v~~i~--~~~g~Lv~~~g~~l~v~~~~~ 798 (1036)
..|.......++||+-.. |+=+|.-.++ -|.+++ ..+|.|+.++ +..++|+.+.-..=++.-|+.
T Consensus 213 ~a~sP~~~~~~a~gsY~q----------~~giy~~~~~~pl~llg--gh~gGvThL~~~edGn~lfsGaRk~dkIl~WDi 280 (406)
T KOG2919|consen 213 FAFSPMDSKTLAVGSYGQ----------RVGIYNDDGRRPLQLLG--GHGGGVTHLQWCEDGNKLFSGARKDDKILCWDI 280 (406)
T ss_pred eeccCCCCcceeeecccc----------eeeeEecCCCCceeeec--ccCCCeeeEEeccCcCeecccccCCCeEEEEee
Confidence 345444466899998422 3333433332 244555 7889999876 446789888776545555654
Q ss_pred cCCC--ccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEec
Q 001655 799 RDDG--TRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 799 ~~~~--~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~ 844 (1036)
+... ..+|.+...-...-.-..+...++.+.-||-.-+|.++..+.
T Consensus 281 R~~~~pv~~L~rhv~~TNQRI~FDld~~~~~LasG~tdG~V~vwdlk~ 328 (406)
T KOG2919|consen 281 RYSRDPVYALERHVGDTNQRILFDLDPKGEILASGDTDGSVRVWDLKD 328 (406)
T ss_pred hhccchhhhhhhhccCccceEEEecCCCCceeeccCCCccEEEEecCC
Confidence 3211 123333221011112245666788888899999998765543
No 213
>PF14655 RAB3GAP2_N: Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=41.70 E-value=2.5e+02 Score=32.22 Aligned_cols=41 Identities=22% Similarity=0.209 Sum_probs=31.3
Q ss_pred EEECCCCCeEeEEEEEEEcCC-------CceEEEEEeeeeCCCCCCCcceEEEEEEEe
Q 001655 707 TYPLDTFEYGCSILSCSFSDD-------SNVYYCVGTAYVLPEENEPTKGRILVFIVE 757 (1036)
Q Consensus 707 ~~~~~~~E~v~si~~~~l~~~-------~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~ 757 (1036)
..+.+++|.++|++.+-+... +..+|+||+ ++|.+.+|.-.
T Consensus 50 ~l~~~~~e~ITsi~clpl~s~~~s~~~~dw~~I~VG~----------ssG~vrfyte~ 97 (415)
T PF14655_consen 50 PLDDEPGECITSILCLPLSSQKRSTGGPDWTCIAVGT----------SSGYVRFYTEN 97 (415)
T ss_pred eccCCCCCEEEEEEEEEeecccccCCCCCcEEEEEEe----------cccEEEEEecc
Confidence 345566799999988877432 268999999 57999999764
No 214
>COG1654 BirA Biotin operon repressor [Transcription]
Probab=39.89 E-value=34 Score=28.95 Aligned_cols=27 Identities=11% Similarity=0.294 Sum_probs=23.9
Q ss_pred HHHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1008 RTRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1008 ~~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
+-..+++++++|.++..|+|.|+.|+.
T Consensus 19 ~~SGe~La~~LgiSRtaVwK~Iq~Lr~ 45 (79)
T COG1654 19 FVSGEKLAEELGISRTAVWKHIQQLRE 45 (79)
T ss_pred cccHHHHHHHHCccHHHHHHHHHHHHH
Confidence 356789999999999999999999984
No 215
>PHA02790 Kelch-like protein; Provisional
Probab=39.88 E-value=4e+02 Score=31.50 Aligned_cols=136 Identities=13% Similarity=0.062 Sum_probs=68.4
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEECC----EEEEEEeeecCCCcc
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAINQ----KIQLYKWMLRDDGTR 804 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~----~l~v~~~~~~~~~~~ 804 (1036)
..++++|.... ... .-.+..|+...++...+.....+-.-.+.+.++|+|++.-|. .+..|. ... +
T Consensus 272 ~~lyviGG~~~----~~~-~~~v~~Ydp~~~~W~~~~~m~~~r~~~~~v~~~~~iYviGG~~~~~sve~yd--p~~-n-- 341 (480)
T PHA02790 272 EVVYLIGGWMN----NEI-HNNAIAVNYISNNWIPIPPMNSPRLYASGVPANNKLYVVGGLPNPTSVERWF--HGD-A-- 341 (480)
T ss_pred CEEEEEcCCCC----CCc-CCeEEEEECCCCEEEECCCCCchhhcceEEEECCEEEEECCcCCCCceEEEE--CCC-C--
Confidence 46777775321 111 113455665566665555433222223445567877665552 344333 321 2
Q ss_pred chhcccccccceEEEEEEEeCCEEEE-Eecccc-EEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEE
Q 001655 805 ELQSECGHHGHILALYVQTRGDFIVV-GDLMKS-ISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLG 874 (1036)
Q Consensus 805 ~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~~S-v~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~ 874 (1036)
++...+....+-......+.+++|+| |-...+ -.+-.|++..++...++.-+.++.-.++..+++.-++.
T Consensus 342 ~W~~~~~l~~~r~~~~~~~~~g~IYviGG~~~~~~~ve~ydp~~~~W~~~~~m~~~r~~~~~~~~~~~IYv~ 413 (480)
T PHA02790 342 AWVNMPSLLKPRCNPAVASINNVIYVIGGHSETDTTTEYLLPNHDQWQFGPSTYYPHYKSCALVFGRRLFLV 413 (480)
T ss_pred eEEECCCCCCCCcccEEEEECCEEEEecCcCCCCccEEEEeCCCCEEEeCCCCCCccccceEEEECCEEEEE
Confidence 23333322222222344567888866 332211 23456898888888887666677655555555433343
No 216
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=39.51 E-value=4.9e+02 Score=27.59 Aligned_cols=191 Identities=20% Similarity=0.277 Sum_probs=84.4
Q ss_pred cCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEE
Q 001655 475 QLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLL 554 (1036)
Q Consensus 475 ~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~ 554 (1036)
.+..++|.|+..+- .....+|. -..+.|..+++. .+++...++....-++.|.++ ++..+++..=++|.|+
T Consensus 19 g~~~e~SGLTy~pd-----~~tLfaV~-d~~~~i~els~~-G~vlr~i~l~g~~D~EgI~y~--g~~~~vl~~Er~~~L~ 89 (248)
T PF06977_consen 19 GILDELSGLTYNPD-----TGTLFAVQ-DEPGEIYELSLD-GKVLRRIPLDGFGDYEGITYL--GNGRYVLSEERDQRLY 89 (248)
T ss_dssp T--S-EEEEEEETT-----TTEEEEEE-TTTTEEEEEETT---EEEEEE-SS-SSEEEEEE---STTEEEEEETTTTEEE
T ss_pred CccCCccccEEcCC-----CCeEEEEE-CCCCEEEEEcCC-CCEEEEEeCCCCCCceeEEEE--CCCEEEEEEcCCCcEE
Confidence 45568999988641 13344444 447788777764 455555556543456777554 4556666665799999
Q ss_pred EEEEecCCCccccc--eeeecCccceE---EEEE-EeCCceEEEEEc-CCceEEEecCC---c--EEEee---ec-----
Q 001655 555 NFLLNMKTGELTDR--KKVSLGTQPIT---LRTF-SSKNTTHVFAAS-DRPTVIYSSNK---K--LLYSN---VN----- 614 (1036)
Q Consensus 555 ~y~~~~~~~~l~~~--~~~~lG~~pv~---l~~~-~~~~~~~v~~~~-~~p~~i~~~~~---~--~~~~~---~~----- 614 (1036)
.++++..+..+... +...+|..... +--+ .....+.+|+.. ..|..++.-++ . +.... +.
T Consensus 90 ~~~~~~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~~ 169 (248)
T PF06977_consen 90 IFTIDDDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKLF 169 (248)
T ss_dssp EEEE----TT--EEEEEEEE---S---SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT--
T ss_pred EEEEeccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccce
Confidence 99987654433222 23334422110 1111 012233444444 55655554332 1 11110 00
Q ss_pred cccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEeCCC----------ccceEEEecCCCEEEEE
Q 001655 615 LKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIPLGE----------HPRRICHQEQSRTFAIC 678 (1036)
Q Consensus 615 ~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~----------tp~~i~y~~~~~~~~v~ 678 (1036)
...+.+++ |+ +. .+.+++.++..=++..++...+ +.+.++|.. +|.-|++.++.++|+|.
T Consensus 170 ~~d~S~l~-~~-p~-t~~lliLS~es~~l~~~d~~G~-~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYIvs 239 (248)
T PF06977_consen 170 VRDLSGLS-YD-PR-TGHLLILSDESRLLLELDRQGR-VVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYIVS 239 (248)
T ss_dssp SS---EEE-EE-TT-TTEEEEEETTTTEEEEE-TT---EEEEEE-STTGGG-SS---SEEEEEE-TT--EEEEE
T ss_pred eccccceE-Ec-CC-CCeEEEEECCCCeEEEECCCCC-EEEEEEeCCcccCcccccCCccEEEECCCCCEEEEc
Confidence 01121211 22 11 2344444544444456664333 456666654 68899999998888876
No 217
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=39.09 E-value=5.3e+02 Score=27.91 Aligned_cols=256 Identities=12% Similarity=0.117 Sum_probs=125.5
Q ss_pred CCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCc-EEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEE-EecCCEEE
Q 001655 434 PPGYSVNVATAN--ASQVLLATGGGHLVYLEIGDG-ILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVG-MWTDISVR 509 (1036)
Q Consensus 434 ~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~-~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg-~w~~~~i~ 509 (1036)
+.+.+|.+-..+ +..++.+..+..+.++...++ +...+....-.-+..|+.-. ...+.-+ +-.|.+|+
T Consensus 12 ~~~~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~skkyG~~~~~Fth~--------~~~~i~sStk~d~tIr 83 (311)
T KOG1446|consen 12 ETNGKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINSKKYGVDLACFTHH--------SNTVIHSSTKEDDTIR 83 (311)
T ss_pred cCCCceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeecccccccEEEEecC--------CceEEEccCCCCCceE
Confidence 345577777744 455555566678888887664 34445444444444444321 1222222 21277899
Q ss_pred EEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCccceEEEEEEeCCce
Q 001655 510 IFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTFSSKNTT 589 (1036)
Q Consensus 510 i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~ 589 (1036)
.++|.+.+-+... -+......++.+.+.+ ...+-+..|..+..+.+...+ .+-...+..+|+ .+|. ...
T Consensus 84 yLsl~dNkylRYF-~GH~~~V~sL~~sP~~--d~FlS~S~D~tvrLWDlR~~~----cqg~l~~~~~pi--~AfD--p~G 152 (311)
T KOG1446|consen 84 YLSLHDNKYLRYF-PGHKKRVNSLSVSPKD--DTFLSSSLDKTVRLWDLRVKK----CQGLLNLSGRPI--AAFD--PEG 152 (311)
T ss_pred EEEeecCceEEEc-CCCCceEEEEEecCCC--CeEEecccCCeEEeeEecCCC----CceEEecCCCcc--eeEC--CCC
Confidence 9998876554321 0111244566666543 455667778888887766322 222334555554 3332 233
Q ss_pred EEEEEcCCc--eEEEec----CCcEEEeeeccccceeeecccCCCCCCeEEEEeCCeEEEEEEcCCCCeEEEEEeCC---
Q 001655 590 HVFAASDRP--TVIYSS----NKKLLYSNVNLKEVSHMCPFNSAAFPDSLAIAKEGELTIGTIDDIQKLHIRSIPLG--- 660 (1036)
Q Consensus 590 ~v~~~~~~p--~~i~~~----~~~~~~~~~~~~~i~~~~~f~~~~~~~~l~~~~~~~l~i~~l~~~~~~~~~~i~l~--- 660 (1036)
-+||.+... .-+|-- +|-+....++...-...+.+.-..++..+++.++++ .+.-++........++...
T Consensus 153 LifA~~~~~~~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iLlsT~~s-~~~~lDAf~G~~~~tfs~~~~~ 231 (311)
T KOG1446|consen 153 LIFALANGSELIKLYDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSILLSTNAS-FIYLLDAFDGTVKSTFSGYPNA 231 (311)
T ss_pred cEEEEecCCCeEEEEEecccCCCCceeEccCCCCccceeeeEEcCCCCEEEEEeCCC-cEEEEEccCCcEeeeEeeccCC
Confidence 466655333 222311 222333333321111112221122334555555433 1223333333223333222
Q ss_pred -CccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEE
Q 001655 661 -EHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSI 719 (1036)
Q Consensus 661 -~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si 719 (1036)
..|---+|.|+++ |++.++.. +.|.+.+.+++..+....=+..-.+.|+
T Consensus 232 ~~~~~~a~ftPds~-Fvl~gs~d---------g~i~vw~~~tg~~v~~~~~~~~~~~~~~ 281 (311)
T KOG1446|consen 232 GNLPLSATFTPDSK-FVLSGSDD---------GTIHVWNLETGKKVAVLRGPNGGPVSCV 281 (311)
T ss_pred CCcceeEEECCCCc-EEEEecCC---------CcEEEEEcCCCcEeeEecCCCCCCcccc
Confidence 2444567888887 44444422 5788888888877766554433334444
No 218
>PHA02790 Kelch-like protein; Provisional
Probab=38.08 E-value=6.9e+02 Score=29.46 Aligned_cols=128 Identities=10% Similarity=0.017 Sum_probs=66.5
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccccCeEEEEEC-----CEEEEEEeeecCCCc
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAFNGKLLAAIN-----QKIQLYKWMLRDDGT 803 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g-----~~l~v~~~~~~~~~~ 803 (1036)
...+++|.... . ..+..|+...++.+.+......=.-.+.+.++|+|++.-| +.+..|+ ..+ +.
T Consensus 319 ~~iYviGG~~~------~--~sve~ydp~~n~W~~~~~l~~~r~~~~~~~~~g~IYviGG~~~~~~~ve~yd--p~~-~~ 387 (480)
T PHA02790 319 NKLYVVGGLPN------P--TSVERWFHGDAAWVNMPSLLKPRCNPAVASINNVIYVIGGHSETDTTTEYLL--PNH-DQ 387 (480)
T ss_pred CEEEEECCcCC------C--CceEEEECCCCeEEECCCCCCCCcccEEEEECCEEEEecCcCCCCccEEEEe--CCC-CE
Confidence 56777775311 1 2244555445566554433221112245556788776544 2344444 221 22
Q ss_pred cchhcccccccceEEEEEEEeCCEEEE-EeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEE
Q 001655 804 RELQSECGHHGHILALYVQTRGDFIVV-GDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLG 874 (1036)
Q Consensus 804 ~~L~~~~~~~~~~~~~~l~~~~~~I~v-gD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~ 874 (1036)
++ ..+....+-.-..+.+.++.|+| |- . .-.|+++.++...++.=+.+|.-.++..+++.-+++
T Consensus 388 W~--~~~~m~~~r~~~~~~~~~~~IYv~GG---~--~e~ydp~~~~W~~~~~m~~~r~~~~~~v~~~~IYvi 452 (480)
T PHA02790 388 WQ--FGPSTYYPHYKSCALVFGRRLFLVGR---N--AEFYCESSNTWTLIDDPIYPRDNPELIIVDNKLLLI 452 (480)
T ss_pred EE--eCCCCCCccccceEEEECCEEEEECC---c--eEEecCCCCcEeEcCCCCCCccccEEEEECCEEEEE
Confidence 32 22222222222344567888876 42 1 345788888888888666677666666666544443
No 219
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=37.86 E-value=5.4e+02 Score=27.64 Aligned_cols=136 Identities=16% Similarity=0.271 Sum_probs=62.2
Q ss_pred CcceEEEEEEEeC--CeEEEEE------------EEEecCceeEeccc-cCeE--EEEECCEEEEEEeeecCCCccchhc
Q 001655 746 PTKGRILVFIVED--GKLQLIA------------EKETKGAVYSLNAF-NGKL--LAAINQKIQLYKWMLRDDGTRELQS 808 (1036)
Q Consensus 746 ~~~Gri~v~~i~~--~kl~~~~------------~~~~~g~v~~i~~~-~g~L--v~~~g~~l~v~~~~~~~~~~~~L~~ 808 (1036)
.+-|++.+|+|.+ +-+..+. ...+.|.|..++-- +|.- .++..+++++++...-++..++..+
T Consensus 208 saDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tSd~~~l~~~gtd~r~r~wn~~~G~ntl~~~g~ 287 (397)
T KOG4283|consen 208 SADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTSDARYLASCGTDDRIRVWNMESGRNTLREFGP 287 (397)
T ss_pred CCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecccchhhhhccCccceEEeecccCccccccccc
Confidence 3668999999883 2222222 23355667666644 3332 3455567777554311222222333
Q ss_pred ccccccceEEEEEEEeCC--EEEE-EeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeC-ceEEEEccCCcEEEE
Q 001655 809 ECGHHGHILALYVQTRGD--FIVV-GDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDD-DIYLGAENNFNLFTV 884 (1036)
Q Consensus 809 ~~~~~~~~~~~~l~~~~~--~I~v-gD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~-~~~l~~D~~gnl~~l 884 (1036)
++-.....+.+.+.+... ++++ .| .|+.++.. -+++++..- +.+-+.+.++.+-.+ .....+|.++|+...
T Consensus 288 ~~~n~~~~~~~~~~~~~s~vfv~~p~~--~~lall~~--~sgs~ir~l-~~h~k~i~c~~~~~~fq~~~tg~~d~ni~~w 362 (397)
T KOG4283|consen 288 IIHNQTTSFAVHIQSMDSDVFVLFPND--GSLALLNL--LEGSFVRRL-STHLKRINCAAYRPDFEQCFTGDMNGNIYMW 362 (397)
T ss_pred ccccccccceEEEeecccceEEEEecC--CeEEEEEc--cCceEEEee-ecccceeeEEeecCchhhhhccccCCccccc
Confidence 332222233444443322 2222 12 45554432 223322221 112333333333222 347788999998765
Q ss_pred ee
Q 001655 885 RK 886 (1036)
Q Consensus 885 ~~ 886 (1036)
-.
T Consensus 363 ~p 364 (397)
T KOG4283|consen 363 SP 364 (397)
T ss_pred cc
Confidence 54
No 220
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=37.50 E-value=6.6e+02 Score=28.47 Aligned_cols=134 Identities=19% Similarity=0.234 Sum_probs=75.6
Q ss_pred eEEEE-eCCeEEEEEEcCCCCe-----EEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEE
Q 001655 632 SLAIA-KEGELTIGTIDDIQKL-----HIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFI 705 (1036)
Q Consensus 632 ~l~~~-~~~~l~i~~l~~~~~~-----~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i 705 (1036)
.++-+ .++..++-+++....+ |..+ .-+++|||+.+.++-+|.+. +-++.|..|.+.+
T Consensus 233 ~lat~s~Dgtvklw~~~~e~~l~~l~gH~~R------Vs~VafHPsG~~L~TasfD~----------tWRlWD~~tk~El 296 (459)
T KOG0272|consen 233 NLATASADGTVKLWKLSQETPLQDLEGHLAR------VSRVAFHPSGKFLGTASFDS----------TWRLWDLETKSEL 296 (459)
T ss_pred ceeeeccCCceeeeccCCCcchhhhhcchhh------heeeeecCCCceeeeccccc----------chhhcccccchhh
Confidence 44443 3788888888764321 2222 34789999999988888763 5566666554332
Q ss_pred EEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc-cCeEE
Q 001655 706 STYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF-NGKLL 784 (1036)
Q Consensus 706 ~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~-~g~Lv 784 (1036)
- +.++.. -.+..+.|..+ ..++ +|+- ..+-||| |++..++..+.-. ....+|++|.-- |||.+
T Consensus 297 L---~QEGHs-~~v~~iaf~~D-GSL~--~tGG------lD~~~Rv--WDlRtgr~im~L~-gH~k~I~~V~fsPNGy~l 360 (459)
T KOG0272|consen 297 L---LQEGHS-KGVFSIAFQPD-GSLA--ATGG------LDSLGRV--WDLRTGRCIMFLA-GHIKEILSVAFSPNGYHL 360 (459)
T ss_pred H---hhcccc-cccceeEecCC-Ccee--eccC------ccchhhe--eecccCcEEEEec-ccccceeeEeECCCceEE
Confidence 1 112211 12222333322 2333 3331 1255675 6776665554443 378899998855 78877
Q ss_pred EEEC--CEEEEEEee
Q 001655 785 AAIN--QKIQLYKWM 797 (1036)
Q Consensus 785 ~~~g--~~l~v~~~~ 797 (1036)
+..+ ++++|+++.
T Consensus 361 ATgs~Dnt~kVWDLR 375 (459)
T KOG0272|consen 361 ATGSSDNTCKVWDLR 375 (459)
T ss_pred eecCCCCcEEEeeec
Confidence 7555 577787653
No 221
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=37.20 E-value=6e+02 Score=27.91 Aligned_cols=251 Identities=18% Similarity=0.282 Sum_probs=119.4
Q ss_pred cEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEecCCCccccceeeecCc
Q 001655 496 QIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLNMKTGELTDRKKVSLGT 575 (1036)
Q Consensus 496 ~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG~ 575 (1036)
..++-|.. |++|.||+..+++.+.. |.+ -.-|++..+...+ .++-|..|-.+.++.+..... ++ .-++-
T Consensus 208 ~kiVSGlr-DnTikiWD~n~~~c~~~--L~G--HtGSVLCLqyd~r-viisGSSDsTvrvWDv~tge~-l~----tlihH 276 (499)
T KOG0281|consen 208 EKIVSGLR-DNTIKIWDKNSLECLKI--LTG--HTGSVLCLQYDER-VIVSGSSDSTVRVWDVNTGEP-LN----TLIHH 276 (499)
T ss_pred hhhhcccc-cCceEEeccccHHHHHh--hhc--CCCcEEeeeccce-EEEecCCCceEEEEeccCCch-hh----HHhhh
Confidence 34555666 89999999887654321 111 1125554554433 567799999999988764321 11 11222
Q ss_pred cceEEE-EEEeCCceEEEEEcCCceEE-Eec--CCc-EEEeeeccccceeeecccCCCCCCe-EEEEe-CCeEEEEEEcC
Q 001655 576 QPITLR-TFSSKNTTHVFAASDRPTVI-YSS--NKK-LLYSNVNLKEVSHMCPFNSAAFPDS-LAIAK-EGELTIGTIDD 648 (1036)
Q Consensus 576 ~pv~l~-~~~~~~~~~v~~~~~~p~~i-~~~--~~~-~~~~~~~~~~i~~~~~f~~~~~~~~-l~~~~-~~~l~i~~l~~ 648 (1036)
.-..|+ .| .++.+++|++-.-+ .++ .+. .....+- +-+-+..+...+.+- ++.++ +..++.=.+.+
T Consensus 277 ceaVLhlrf----~ng~mvtcSkDrsiaVWdm~sps~it~rrVL---vGHrAaVNvVdfd~kyIVsASgDRTikvW~~st 349 (499)
T KOG0281|consen 277 CEAVLHLRF----SNGYMVTCSKDRSIAVWDMASPTDITLRRVL---VGHRAAVNVVDFDDKYIVSASGDRTIKVWSTST 349 (499)
T ss_pred cceeEEEEE----eCCEEEEecCCceeEEEeccCchHHHHHHHH---hhhhhheeeeccccceEEEecCCceEEEEeccc
Confidence 211121 22 13455555432211 111 000 0000000 011223333334343 33344 34455444332
Q ss_pred CCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCe-EeEEEEEEEcCC
Q 001655 649 IQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEY-GCSILSCSFSDD 727 (1036)
Q Consensus 649 ~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~-v~si~~~~l~~~ 727 (1036)
.. .+|.+ .+--|-|+-......++|..+.. .++++.|...+..+. -++-+|. +-| +.|.
T Consensus 350 ~e--fvRtl--~gHkRGIAClQYr~rlvVSGSSD---------ntIRlwdi~~G~cLR--vLeGHEeLvRc---iRFd-- 409 (499)
T KOG0281|consen 350 CE--FVRTL--NGHKRGIACLQYRDRLVVSGSSD---------NTIRLWDIECGACLR--VLEGHEELVRC---IRFD-- 409 (499)
T ss_pred ee--eehhh--hcccccceehhccCeEEEecCCC---------ceEEEEeccccHHHH--HHhchHHhhhh---eeec--
Confidence 21 12221 23334566666666677665432 478998887665443 2334443 333 3454
Q ss_pred CceEEEEEeeeeCCCCCCCcceEEEEEEEeC--------CeEEEEEEEEecCceeEeccccCe-EEEEE-CCEEEEEEe
Q 001655 728 SNVYYCVGTAYVLPEENEPTKGRILVFIVED--------GKLQLIAEKETKGAVYSLNAFNGK-LLAAI-NQKIQLYKW 796 (1036)
Q Consensus 728 ~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~--------~kl~~~~~~~~~g~v~~i~~~~g~-Lv~~~-g~~l~v~~~ 796 (1036)
.+-|+-|. .-|.|.+|++.- +.+-+.+--+..|.|..+. |+.+ |+.+. ..+|.++++
T Consensus 410 -~krIVSGa----------YDGkikvWdl~aaldpra~~~~~Cl~~lv~hsgRVFrLQ-FD~fqIvsssHddtILiWdF 476 (499)
T KOG0281|consen 410 -NKRIVSGA----------YDGKIKVWDLQAALDPRAPASTLCLRTLVEHSGRVFRLQ-FDEFQIISSSHDDTILIWDF 476 (499)
T ss_pred -Cceeeecc----------ccceEEEEecccccCCcccccchHHHhhhhccceeEEEe-ecceEEEeccCCCeEEEEEc
Confidence 34455443 558888988761 2344455556667777765 5553 43332 245556554
No 222
>KOG3679 consensus Predicted coiled-coil protein [General function prediction only]
Probab=34.56 E-value=1.5e+02 Score=32.06 Aligned_cols=73 Identities=18% Similarity=0.255 Sum_probs=48.6
Q ss_pred ecCccceEE--EEEEeCCceEEEEEcCCceEEEecCCcEEEeeeccccceeeecccCCC--CCCeEEEEeCCeEEEEE
Q 001655 572 SLGTQPITL--RTFSSKNTTHVFAASDRPTVIYSSNKKLLYSNVNLKEVSHMCPFNSAA--FPDSLAIAKEGELTIGT 645 (1036)
Q Consensus 572 ~lG~~pv~l--~~~~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~~~~i~~~~~f~~~~--~~~~l~~~~~~~l~i~~ 645 (1036)
.+|.+...+ ..| ....+.||+.|+|-++...++|.++|..--...-.++.|+.+.. .-+.++.-.++.|.|.+
T Consensus 195 nigeqaldicivsf-nqsassvfvlgernffclkdngqirfmkrldwspscflpycsvsegtintlignhnnmlhiyq 271 (802)
T KOG3679|consen 195 NIGEQALDICIVSF-NQSASSVFVLGERNFFCLKDNGQIRFMKRLDWSPSCFLPYCSVSEGTINTLIGNHNNMLHIYQ 271 (802)
T ss_pred ccChhhheEEEEEe-ccccceEEEEeccceEEEccCCEEEEeeccCCCcccccccccccccchhhhhcCCCceEEeee
Confidence 456555433 333 23467899999999999999998887654334456777776532 22456666678888876
No 223
>PF12234 Rav1p_C: RAVE protein 1 C terminal; InterPro: IPR022033 This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits.
Probab=33.99 E-value=4.8e+02 Score=31.73 Aligned_cols=107 Identities=16% Similarity=0.139 Sum_probs=60.9
Q ss_pred CCCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEEC---------CC
Q 001655 445 NASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSL---------PD 515 (1036)
Q Consensus 445 ~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l---------~~ 515 (1036)
.+...+|-.++..+...+...+.++..+.++-...|-.++..+.++ ....++||+- +.+.+|.- |.
T Consensus 40 ~~k~a~V~~~~~~LtIWD~~~~~lE~~~~f~~~~~I~dLDWtst~d---~qsiLaVGf~--~~v~l~~Q~R~dy~~~~p~ 114 (631)
T PF12234_consen 40 IKKIAVVDSSRSELTIWDTRSGVLEYEESFSEDDPIRDLDWTSTPD---GQSILAVGFP--HHVLLYTQLRYDYTNKGPS 114 (631)
T ss_pred cCcEEEEECCCCEEEEEEcCCcEEEEeeeecCCCceeeceeeecCC---CCEEEEEEcC--cEEEEEEccchhhhcCCcc
Confidence 4566666656667766666666666666565577788888765544 3678899865 56777752 22
Q ss_pred CCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 516 LNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 516 l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
...+..-.+. +..|+.|-=..+.+.-+|+||++|...+..+
T Consensus 115 w~~i~~i~i~-~~T~h~Igds~Wl~~G~LvV~sGNqlfv~dk 155 (631)
T PF12234_consen 115 WAPIRKIDIS-SHTPHPIGDSIWLKDGTLVVGSGNQLFVFDK 155 (631)
T ss_pred cceeEEEEee-cCCCCCccceeEecCCeEEEEeCCEEEEECC
Confidence 2222222221 1233322111123456799999887544433
No 224
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=33.80 E-value=91 Score=37.28 Aligned_cols=104 Identities=13% Similarity=0.188 Sum_probs=57.0
Q ss_pred CceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEecCceeEeccc--cCeEEEEEC--CEEEEEEeeecCCCc
Q 001655 728 SNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKETKGAVYSLNAF--NGKLLAAIN--QKIQLYKWMLRDDGT 803 (1036)
Q Consensus 728 ~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~~g~v~~i~~~--~g~Lv~~~g--~~l~v~~~~~~~~~~ 803 (1036)
..+|+++|+ ..|.+|+|.=..++...+.. +.....++++.+ +++++++.+ ..|.+|.++.. +.
T Consensus 44 t~~~l~~Gs----------S~G~lyl~~R~~~~~~~~~~-~~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql~~~--~p 110 (726)
T KOG3621|consen 44 TEEYLAMGS----------SAGSVYLYNRHTGEMRKLKN-EGATGITCVRSVSSVEYLVAAGTASGRVSVFQLNKE--LP 110 (726)
T ss_pred CCceEEEec----------ccceEEEEecCchhhhcccc-cCccceEEEEEecchhHhhhhhcCCceEEeehhhcc--CC
Confidence 478999998 57999999755333333222 223333333333 456665544 46667766431 22
Q ss_pred cchhccccccc--ceEEEEEEEeC--CEEEEEeccccEEEEEEec
Q 001655 804 RELQSECGHHG--HILALYVQTRG--DFIVVGDLMKSISLLIYKH 844 (1036)
Q Consensus 804 ~~L~~~~~~~~--~~~~~~l~~~~--~~I~vgD~~~Sv~~~~~~~ 844 (1036)
..+.-....+. ..-++++.+.. -+++.||..-=|.+.+.+.
T Consensus 111 ~~~~~~t~~d~~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~s 155 (726)
T KOG3621|consen 111 RDLDYVTPCDKSHKCRVTALEWSKNGMKLYSGDSQGKVVLTELDS 155 (726)
T ss_pred CcceeeccccccCCceEEEEEecccccEEeecCCCceEEEEEech
Confidence 22221111111 22355666654 4899999988777766554
No 225
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=33.56 E-value=6.4e+02 Score=27.20 Aligned_cols=156 Identities=19% Similarity=0.216 Sum_probs=81.6
Q ss_pred ceEEEEEeeeeCCCCCCC--cceEEEEEEEeCCeEE---EEEEEEecC---ceeEeccccCe---EEEEECCEEEEEEee
Q 001655 729 NVYYCVGTAYVLPEENEP--TKGRILVFIVEDGKLQ---LIAEKETKG---AVYSLNAFNGK---LLAAINQKIQLYKWM 797 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~--~~Gri~v~~i~~~kl~---~~~~~~~~g---~v~~i~~~~g~---Lv~~~g~~l~v~~~~ 797 (1036)
.+.+++||-....+.... ..|++++|.+.+.++. .+-.+++.+ .--++.+.+|. +.+-.-..|.+|+.+
T Consensus 24 ~~vLa~GTY~Lde~d~~smvR~Gkl~Lys~~d~~~~~l~~~q~~dts~~~dm~w~~~~~~g~~~l~~a~a~G~i~~~r~~ 103 (339)
T KOG0280|consen 24 RNVLAAGTYLLDEGDYPSMVRSGKLHLYSLEDMKLSPLDTLQCTDTSTEFDMLWRIRETDGDFNLLDAHARGQIQLYRND 103 (339)
T ss_pred cceEEEeeEEecCCCCchheeccceEEEeecccccCccceeeeecccccceeeeeeccCCccceeeeccccceEEEEeec
Confidence 569999998765442222 5799999999865533 222222222 11233333443 333344567777765
Q ss_pred ecCCCccchhcccccccceE-E--EEEEEeCCEEEEEeccccEEEEEEeccCCeEEEEe---ccCCcceeEEEEEeeCce
Q 001655 798 LRDDGTRELQSECGHHGHIL-A--LYVQTRGDFIVVGDLMKSISLLIYKHEEGAIEERA---RDYNANWMSAVEILDDDI 871 (1036)
Q Consensus 798 ~~~~~~~~L~~~~~~~~~~~-~--~~l~~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a---~D~~~~~~~~~~~l~~~~ 871 (1036)
+.. ...-|.+....+.... + +.+...+..|+++|..-++..+..+ ...+.-++ -...+.|+.+......+-
T Consensus 104 ~~~-ss~~L~~ls~~ki~~~~~lslD~~~~~~~i~vs~s~G~~~~v~~t--~~~le~vq~wk~He~E~Wta~f~~~~pnl 180 (339)
T KOG0280|consen 104 EDE-SSVHLRGLSSKKISVVEALSLDISTSGTKIFVSDSRGSISGVYET--EMVLEKVQTWKVHEFEAWTAKFSDKEPNL 180 (339)
T ss_pred cce-eeeeecccchhhhhheeeeEEEeeccCceEEEEcCCCcEEEEecc--eeeeeecccccccceeeeeeecccCCCce
Confidence 321 1222333222222222 3 3445567889999999999855332 22222211 122345654444333344
Q ss_pred EEEEccCCcEEEEeeC
Q 001655 872 YLGAENNFNLFTVRKN 887 (1036)
Q Consensus 872 ~l~~D~~gnl~~l~~~ 887 (1036)
+..+-.+|.+..+...
T Consensus 181 vytGgDD~~l~~~D~R 196 (339)
T KOG0280|consen 181 VYTGGDDGSLSCWDIR 196 (339)
T ss_pred EEecCCCceEEEEEec
Confidence 5555567888877654
No 226
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=33.55 E-value=6.3e+02 Score=27.25 Aligned_cols=99 Identities=15% Similarity=0.079 Sum_probs=50.9
Q ss_pred EEEEcCCeEEEEEEcC----cEEEEEEeccCCc-eeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecC
Q 001655 450 LLATGGGHLVYLEIGD----GILTEVKHAQLEY-EISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHL 524 (1036)
Q Consensus 450 vv~~~~~~~~~l~~~~----~~l~~~~~~~l~~-~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l 524 (1036)
+.+-..|.+.+++.+. .-|..+....+.. +..|+++++. +.-++++.- +|++.+.+.....+...+..
T Consensus 89 ~~a~a~G~i~~~r~~~~~ss~~L~~ls~~ki~~~~~lslD~~~~------~~~i~vs~s-~G~~~~v~~t~~~le~vq~w 161 (339)
T KOG0280|consen 89 LDAHARGQIQLYRNDEDESSVHLRGLSSKKISVVEALSLDISTS------GTKIFVSDS-RGSISGVYETEMVLEKVQTW 161 (339)
T ss_pred eeccccceEEEEeeccceeeeeecccchhhhhheeeeEEEeecc------CceEEEEcC-CCcEEEEecceeeeeecccc
Confidence 3344456677766654 1233333333322 2456666543 345777766 78887655443222111111
Q ss_pred CCccCceeEE--eeeec--CeEEEEEEeCCCcEEEEEEe
Q 001655 525 GGEIIPRSVL--LCAFE--GISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 525 ~~~~~p~si~--~~~~~--~~~~L~vgl~~G~l~~y~~~ 559 (1036)
.++... .+.+. ..+.++-|..||.+..+.+.
T Consensus 162 ----k~He~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R 196 (339)
T KOG0280|consen 162 ----KVHEFEAWTAKFSDKEPNLVYTGGDDGSLSCWDIR 196 (339)
T ss_pred ----cccceeeeeeecccCCCceEEecCCCceEEEEEec
Confidence 122111 11221 23567889999999999886
No 227
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=33.02 E-value=9.3e+02 Score=28.99 Aligned_cols=155 Identities=20% Similarity=0.126 Sum_probs=82.8
Q ss_pred EecCceeEecc-c-cCeEEEEEC--CEEEEEEeeecCCCccchhc------ccccc-cc-eEEEEEEEeC--CEEEEEec
Q 001655 768 ETKGAVYSLNA-F-NGKLLAAIN--QKIQLYKWMLRDDGTRELQS------ECGHH-GH-ILALYVQTRG--DFIVVGDL 833 (1036)
Q Consensus 768 ~~~g~v~~i~~-~-~g~Lv~~~g--~~l~v~~~~~~~~~~~~L~~------~~~~~-~~-~~~~~l~~~~--~~I~vgD~ 833 (1036)
+++.-|.|++. . ++.++++.| .+|.+|+++. +..+++. .+... ++ ..+.++.... ..|+-|+.
T Consensus 115 ~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~---~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~t~t~ivsGgt 191 (735)
T KOG0308|consen 115 THKDYVKCLAYIAKNNELVASGGLDRKIFLWDINT---GTATLVASFNNVTVNSLGSGPKDSIYSLAMNQTGTIIVSGGT 191 (735)
T ss_pred cccchheeeeecccCceeEEecCCCccEEEEEccC---cchhhhhhccccccccCCCCCccceeeeecCCcceEEEecCc
Confidence 55667777776 3 345665544 7888887751 2112211 11111 11 1223444433 37777888
Q ss_pred cccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCc-eEEEEccCCcEEEEeeCCCCCCcccccceeEEEEEEcCCccc
Q 001655 834 MKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDD-IYLGAENNFNLFTVRKNSEGATDEERGRLEVVGEYHLGEFVN 912 (1036)
Q Consensus 834 ~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~-~~l~~D~~gnl~~l~~~~~~~~~~~~~~L~~~~~~~lg~~v~ 912 (1036)
.+-+.++..+.....|.+.+ +.-.|.++...+++ +++.+-.+|.|.+..... ++.. +.|++.+..
T Consensus 192 ek~lr~wDprt~~kimkLrG---HTdNVr~ll~~dDGt~~ls~sSDgtIrlWdLgq--------QrCl--~T~~vH~e~- 257 (735)
T KOG0308|consen 192 EKDLRLWDPRTCKKIMKLRG---HTDNVRVLLVNDDGTRLLSASSDGTIRLWDLGQ--------QRCL--ATYIVHKEG- 257 (735)
T ss_pred ccceEEeccccccceeeeec---cccceEEEEEcCCCCeEeecCCCceEEeeeccc--------ccee--eeEEeccCc-
Confidence 88887753333333444443 23345566556665 488888999999988764 3333 235444333
Q ss_pred eEEeeeeeecCCCCCCCCcceEEEEccccceEEEEec
Q 001655 913 RFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASL 949 (1036)
Q Consensus 913 ~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l 949 (1036)
.+++... ..=..+.+|..+|-|+ .++|
T Consensus 258 ---VWaL~~~------~sf~~vYsG~rd~~i~-~Tdl 284 (735)
T KOG0308|consen 258 ---VWALQSS------PSFTHVYSGGRDGNIY-RTDL 284 (735)
T ss_pred ---eEEEeeC------CCcceEEecCCCCcEE-eccc
Confidence 1333210 1223566667788776 4555
No 228
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=33.00 E-value=6.6e+02 Score=27.16 Aligned_cols=73 Identities=16% Similarity=0.285 Sum_probs=42.0
Q ss_pred eEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCee----E--EecCCCccCceeEEeeeec-CeEEEEEEeCCCc
Q 001655 480 ISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLI----T--KEHLGGEIIPRSVLLCAFE-GISYLLCALGDGH 552 (1036)
Q Consensus 480 is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v----~--~~~l~~~~~p~si~~~~~~-~~~~L~vgl~~G~ 552 (1036)
+-|-.++| .+.+++-|.- ||-|++|+.-+.++- + ...+- ..-..++...+. +...|--|..||.
T Consensus 216 ~EcA~FSP------DgqyLvsgSv-DGFiEVWny~~GKlrKDLkYQAqd~fM--Mmd~aVlci~FSRDsEMlAsGsqDGk 286 (508)
T KOG0275|consen 216 VECARFSP------DGQYLVSGSV-DGFIEVWNYTTGKLRKDLKYQAQDNFM--MMDDAVLCISFSRDSEMLASGSQDGK 286 (508)
T ss_pred hhheeeCC------CCceEeeccc-cceeeeehhccchhhhhhhhhhhccee--ecccceEEEeecccHHHhhccCcCCc
Confidence 34555654 3678888877 999999987543321 1 11110 011122222332 3345666889999
Q ss_pred EEEEEEecC
Q 001655 553 LLNFLLNMK 561 (1036)
Q Consensus 553 l~~y~~~~~ 561 (1036)
+-++++...
T Consensus 287 IKvWri~tG 295 (508)
T KOG0275|consen 287 IKVWRIETG 295 (508)
T ss_pred EEEEEEecc
Confidence 999998754
No 229
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=32.84 E-value=1.6e+02 Score=20.62 Aligned_cols=29 Identities=24% Similarity=0.442 Sum_probs=21.2
Q ss_pred CeEEEEEEcCCCCeEEEEEeCCCccceEEEe
Q 001655 639 GELTIGTIDDIQKLHIRSIPLGEHPRRICHQ 669 (1036)
Q Consensus 639 ~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~ 669 (1036)
+.+.+ ++.......+++++++.|+.++++
T Consensus 14 ~~v~~--id~~~~~~~~~i~vg~~P~~i~~~ 42 (42)
T TIGR02276 14 NTVSV--IDTATNKVIATIPVGGYPFGVAVS 42 (42)
T ss_pred CEEEE--EECCCCeEEEEEECCCCCceEEeC
Confidence 44444 555556678899999999998863
No 230
>PF08279 HTH_11: HTH domain; InterPro: IPR013196 Winged helix DNA-binding proteins share a related winged helix-turn-helix DNA-binding motif, where the "wings", or loops, are small beta-sheets. The winged helix motif consists of two wings (W1, W2), three alpha helices (H1, H2, H3) and three beta-sheets (S1, S2, S3) arranged in the order H1-S1-H2-H3-S2-W1-S3-W2 []. The DNA-recognition helix makes sequence-specific DNA contacts with the major groove of DNA, while the wings make different DNA contacts, often with the minor groove or the backbone of DNA. Several winged-helix proteins display an exposed patch of hydrophobic residues thought to mediate protein-protein interactions. This entry represents a subset of the winged helix domain superfamily which is predominantly found in bacterial proteins, though there are also some archaeal and eukaryotic examples. This domain is commonly found in the biotin (vitamin H) repressor protein BirA which regulates transcription of the biotin operon []. It is also found in other proteins including regulators of amino acid biosynthsis such as LysM [], and regulators of carbohydrate metabolisms such as LicR and FrvR [, ].; PDB: 1HXD_B 2EWN_B 1BIA_A 1BIB_A 1J5Y_A 3V7S_A 3V7C_A 3RKW_A 3RIR_A 3RKX_A ....
Probab=32.75 E-value=53 Score=25.23 Aligned_cols=26 Identities=19% Similarity=0.383 Sum_probs=22.3
Q ss_pred HHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1009 TRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1009 ~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
-...++|+.+|+|...|.++|++|+.
T Consensus 16 it~~eLa~~l~vS~rTi~~~i~~L~~ 41 (55)
T PF08279_consen 16 ITAKELAEELGVSRRTIRRDIKELRE 41 (55)
T ss_dssp BEHHHHHHHCTS-HHHHHHHHHHHHH
T ss_pred cCHHHHHHHhCCCHHHHHHHHHHHHH
Confidence 46789999999999999999999875
No 231
>PF06977 SdiA-regulated: SdiA-regulated; InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=32.29 E-value=1.3e+02 Score=31.83 Aligned_cols=61 Identities=20% Similarity=0.329 Sum_probs=34.6
Q ss_pred CCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEc-----CccccceEEEEecCCeEEEEEeecCeeEEEE
Q 001655 212 DGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELL-----GETSIASTISYLDNAVVYIGSSYGDSQLIKL 276 (1036)
Q Consensus 212 ~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~-----~~~~~~s~l~~l~~~~lF~gS~~gds~l~~~ 276 (1036)
+++.++|++++..| +.++.+|+.+..+.+..- ...+.|..++...+|.||+.|+ ...+|++
T Consensus 182 t~~lliLS~es~~l--~~~d~~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LYIvsE--pNlfy~f 247 (248)
T PF06977_consen 182 TGHLLILSDESRLL--LELDRQGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLYIVSE--PNLFYRF 247 (248)
T ss_dssp TTEEEEEETTTTEE--EEE-TT--EEEEEE-STTGGG-SS---SEEEEEE-TT--EEEEET--TTEEEEE
T ss_pred CCeEEEEECCCCeE--EEECCCCCEEEEEEeCCcccCcccccCCccEEEECCCCCEEEEcC--CceEEEe
Confidence 44556666676666 444566665555554331 2357899999999999999997 5577776
No 232
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=31.37 E-value=6.9e+02 Score=26.93 Aligned_cols=265 Identities=16% Similarity=0.186 Sum_probs=123.1
Q ss_pred CCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceE----EEEecCC-eEEEEEeecCeeEEEEeeCCCCCCCc
Q 001655 212 DGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIAST----ISYLDNA-VVYIGSSYGDSQLIKLNLQPDAKGSY 286 (1036)
Q Consensus 212 ~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~----l~~l~~~-~lF~gS~~gds~l~~~~~~~~~~~~~ 286 (1036)
+..+++=+.+||.|..=.--. .+ ... .++.|++ .++-+++ ++-.|+-.....+|.+..++++..
T Consensus 66 Dsr~ivSaSqDGklIvWDs~T-tn---K~h-----aipl~s~WVMtCA~sPSg~~VAcGGLdN~Csiy~ls~~d~~g~-- 134 (343)
T KOG0286|consen 66 DSRRIVSASQDGKLIVWDSFT-TN---KVH-----AIPLPSSWVMTCAYSPSGNFVACGGLDNKCSIYPLSTRDAEGN-- 134 (343)
T ss_pred CcCeEEeeccCCeEEEEEccc-cc---cee-----EEecCceeEEEEEECCCCCeEEecCcCceeEEEeccccccccc--
Confidence 445666677888875432211 11 122 2344443 2233343 444565555678888875432211
Q ss_pred EEEeeecccC-CceeeeEEeccCCCCCceEEEEeeCCCCccEEEEecCCceeEEEeeeCCCc-ceEEEeecCCCCCcccE
Q 001655 287 VEVLERYVNL-GPIVDFCVVDLERQGQGQVVTCSGAYKDGSLRIVRNGIGINEQASVELQGI-KGMWSLRSSTDDPFDTF 364 (1036)
Q Consensus 287 ~~~~~~l~n~-~Pi~D~~~~~~~~~~~~~lv~~sG~g~~g~l~~lr~gi~~~~~~~~~l~~~-~~iw~l~~~~~~~~~~~ 364 (1036)
..+...++.. |-+.+..+.+ ..+|++.||-.. =+|--+..|....... |- -.+.++..+.. +.+.|
T Consensus 135 ~~v~r~l~gHtgylScC~f~d-----D~~ilT~SGD~T-CalWDie~g~~~~~f~-----GH~gDV~slsl~p~-~~ntF 202 (343)
T KOG0286|consen 135 VRVSRELAGHTGYLSCCRFLD-----DNHILTGSGDMT-CALWDIETGQQTQVFH-----GHTGDVMSLSLSPS-DGNTF 202 (343)
T ss_pred ceeeeeecCccceeEEEEEcC-----CCceEecCCCce-EEEEEcccceEEEEec-----CCcccEEEEecCCC-CCCeE
Confidence 3444455554 3444455554 257888777443 3455566665444322 21 14444443321 22334
Q ss_pred EEEEecCceEEEEecCCCCeeeeeecCeeccccceeeeecCCC-eEEEEe-cCcEEEEecCCccceeeeeCC-CCCcEEE
Q 001655 365 LVVSFISETRILAMNLEDELEETEIEGFCSQTQTLFCHDAIYN-QLVQVT-SGSVRLVSSTSRELRNEWKSP-PGYSVNV 441 (1036)
Q Consensus 365 lv~S~~~~T~vl~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~-~~vQVt-~~~i~l~~~~~~~~~~~w~~~-~~~~I~~ 441 (1036)
+=-+-...++++.+.++.-.. .+.|-..+-.++.+ +++| .++-=. ...+|+++...-+.+.....+ ....|+.
T Consensus 203 vSg~cD~~aklWD~R~~~c~q--tF~ghesDINsv~f--fP~G~afatGSDD~tcRlyDlRaD~~~a~ys~~~~~~gitS 278 (343)
T KOG0286|consen 203 VSGGCDKSAKLWDVRSGQCVQ--TFEGHESDINSVRF--FPSGDAFATGSDDATCRLYDLRADQELAVYSHDSIICGITS 278 (343)
T ss_pred EecccccceeeeeccCcceeE--eecccccccceEEE--ccCCCeeeecCCCceeEEEeecCCcEEeeeccCcccCCcee
Confidence 333344455666554431111 12222222222221 1122 122111 234577775542333333221 2234666
Q ss_pred EEeC--CCEEEEEEcCCeEEEEEEcCcE-EEEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEE
Q 001655 442 ATAN--ASQVLLATGGGHLVYLEIGDGI-LTEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFS 512 (1036)
Q Consensus 442 as~~--~~~vvv~~~~~~~~~l~~~~~~-l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~ 512 (1036)
.+.+ +..++....+.....-+.-.++ .-.+ .--+..|||+.++| .+.-++-|.| |..++||+
T Consensus 279 v~FS~SGRlLfagy~d~~c~vWDtlk~e~vg~L--~GHeNRvScl~~s~------DG~av~TgSW-Ds~lriW~ 343 (343)
T KOG0286|consen 279 VAFSKSGRLLFAGYDDFTCNVWDTLKGERVGVL--AGHENRVSCLGVSP------DGMAVATGSW-DSTLRIWA 343 (343)
T ss_pred EEEcccccEEEeeecCCceeEeeccccceEEEe--eccCCeeEEEEECC------CCcEEEecch-hHheeecC
Confidence 5533 4455544444333222211111 1111 13367899999865 2567888899 98999874
No 233
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=30.05 E-value=8.8e+02 Score=27.69 Aligned_cols=128 Identities=15% Similarity=0.103 Sum_probs=67.2
Q ss_pred CCcEEEEEeCC--CEEEE-EEcCCeEEEEEEcCcEEEE-EEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEE
Q 001655 436 GYSVNVATANA--SQVLL-ATGGGHLVYLEIGDGILTE-VKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIF 511 (1036)
Q Consensus 436 ~~~I~~as~~~--~~vvv-~~~~~~~~~l~~~~~~l~~-~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~ 511 (1036)
+.+|.+.+..+ ..+++ ...++.+.+..... ... -....++.+|--++..+. .....++++- +|.++-|
T Consensus 286 ~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~--~~~s~~~wk~~g~VEkv~w~~~-----se~~f~~~td-dG~v~~~ 357 (463)
T KOG0270|consen 286 GKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRD--PSNSGKEWKFDGEVEKVAWDPH-----SENSFFVSTD-DGTVYYF 357 (463)
T ss_pred CCceeEEEecCCCceEEEeccccceEEeeeccC--ccccCceEEeccceEEEEecCC-----CceeEEEecC-CceEEee
Confidence 34455555432 23333 33345565555431 111 122455666666666542 2456667766 9999999
Q ss_pred ECCCC-CeeEEecCCCccCceeEEeeeecCeEE-EEEEeCCCcEEEEEEecCCCccccceeeecC
Q 001655 512 SLPDL-NLITKEHLGGEIIPRSVLLCAFEGISY-LLCALGDGHLLNFLLNMKTGELTDRKKVSLG 574 (1036)
Q Consensus 512 ~l~~l-~~v~~~~l~~~~~p~si~~~~~~~~~~-L~vgl~~G~l~~y~~~~~~~~l~~~~~~~lG 574 (1036)
.+... +++++..-. +.....+.+.. ..+. |.-+..++.+-.+.++..+......+...+|
T Consensus 358 D~R~~~~~vwt~~AH-d~~ISgl~~n~--~~p~~l~t~s~d~~Vklw~~~~~~~~~v~~~~~~~~ 419 (463)
T KOG0270|consen 358 DIRNPGKPVWTLKAH-DDEISGLSVNI--QTPGLLSTASTDKVVKLWKFDVDSPKSVKEHSFKLG 419 (463)
T ss_pred ecCCCCCceeEEEec-cCCcceEEecC--CCCcceeeccccceEEEEeecCCCCccccccccccc
Confidence 98765 556542221 11223333322 2333 4458889999999887655444333444555
No 234
>PF04053 Coatomer_WDAD: Coatomer WD associated region ; InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits. This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=29.62 E-value=9.5e+02 Score=27.97 Aligned_cols=139 Identities=15% Similarity=0.141 Sum_probs=67.9
Q ss_pred CCCCeEEECCCCCEEEEEecCCeEEEEeCCCCCccccceecccCCceEEEEEeecCCCCCEEEEEEEecCCcceEEEEEE
Q 001655 64 DNGQIGIIDPDCRLIGLHLYDGLFKVIPFDNKGQLKEAFNIRLEELQVLDIKFLYGCAKPTIVVLYQDNKDARHVKTYEV 143 (1036)
Q Consensus 64 ~~~~~l~vdp~~r~~~~~~~~~~~~ilp~~~~~~~~~~~~~~l~~~~i~d~~FL~~~~~ptlavL~~~~~~~~~l~~~~~ 143 (1036)
..+..+..+|.||++++ ..+|...|+..... ++ . ..+.-.+++|.. .-.+|++.... .+..|
T Consensus 33 ~~p~~ls~npngr~v~V-~g~geY~iyt~~~~---r~----k-~~G~g~~~vw~~---~n~yAv~~~~~----~I~I~-- 94 (443)
T PF04053_consen 33 IYPQSLSHNPNGRFVLV-CGDGEYEIYTALAW---RN----K-AFGSGLSFVWSS---RNRYAVLESSS----TIKIY-- 94 (443)
T ss_dssp S--SEEEE-TTSSEEEE-EETTEEEEEETTTT---EE----E-EEEE-SEEEE-T---SSEEEEE-TTS-----EEEE--
T ss_pred cCCeeEEECCCCCEEEE-EcCCEEEEEEccCC---cc----c-ccCceeEEEEec---CccEEEEECCC----eEEEE--
Confidence 33568899999999998 67777778762211 00 0 114667788875 33588877621 23332
Q ss_pred eccCCceeeccccccccCCCCCEEEecCCCCcceEEEeCc-eEEEEcCCc---eeeeccCcceeeEEEEEecCCCEEEEE
Q 001655 144 ALKDKDFVEGPWSQNNLDNGADLLIPVPPPLCGVLIIGEE-TIVYCSANA---FKAIPIRPSITKAYGRVDADGSRYLLG 219 (1036)
Q Consensus 144 ~~~~~~~~~~~~~~~~lp~~~~~lip~p~~~~G~lv~~~~-~i~y~~~~~---~~~~~~~~~~~~~~~~~~~~~~~~ll~ 219 (1036)
+++.........+|..+..|.+ |-+|.+..+ .|.++|... ...+.+++.....| ..+++.+.+.
T Consensus 95 ----kn~~~~~~k~i~~~~~~~~If~-----G~LL~~~~~~~i~~yDw~~~~~i~~i~v~~vk~V~W---s~~g~~val~ 162 (443)
T PF04053_consen 95 ----KNFKNEVVKSIKLPFSVEKIFG-----GNLLGVKSSDFICFYDWETGKLIRRIDVSAVKYVIW---SDDGELVALV 162 (443)
T ss_dssp ----ETTEE-TT-----SS-EEEEE------SSSEEEEETTEEEEE-TTT--EEEEESS-E-EEEEE----TTSSEEEEE
T ss_pred ----EcCccccceEEcCCcccceEEc-----CcEEEEECCCCEEEEEhhHcceeeEEecCCCcEEEE---ECCCCEEEEE
Confidence 1222211111345555667766 456655555 599999875 34455554122234 3355666666
Q ss_pred cCccCEEEEEEEec
Q 001655 220 DHAGLLHLLVITHE 233 (1036)
Q Consensus 220 ~~~G~l~~l~l~~~ 233 (1036)
.++ .+|.+..+.+
T Consensus 163 t~~-~i~il~~~~~ 175 (443)
T PF04053_consen 163 TKD-SIYILKYNLE 175 (443)
T ss_dssp -S--SEEEEEE-HH
T ss_pred eCC-eEEEEEecch
Confidence 544 6777777655
No 235
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=29.37 E-value=9.9e+02 Score=28.09 Aligned_cols=75 Identities=19% Similarity=0.292 Sum_probs=48.2
Q ss_pred ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCC
Q 001655 662 HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLP 741 (1036)
Q Consensus 662 tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~ 741 (1036)
.++.++++++.+.+|+++-+ .+||++|-.+++.++.. +..--.+-+..|.- ...||++|.
T Consensus 292 ~in~f~FS~DG~~LA~VSqD----------GfLRvF~fdt~eLlg~m--kSYFGGLLCvcWSP---DGKyIvtGG----- 351 (636)
T KOG2394|consen 292 SINEFAFSPDGKYLATVSQD----------GFLRIFDFDTQELLGVM--KSYFGGLLCVCWSP---DGKYIVTGG----- 351 (636)
T ss_pred cccceeEcCCCceEEEEecC----------ceEEEeeccHHHHHHHH--HhhccceEEEEEcC---CccEEEecC-----
Confidence 67889999998888877643 69999999888766421 12222233345643 367999885
Q ss_pred CCCCCcceEEEEEEEeCCeE
Q 001655 742 EENEPTKGRILVFIVEDGKL 761 (1036)
Q Consensus 742 ~e~~~~~Gri~v~~i~~~kl 761 (1036)
|| --+.||.+.++|+
T Consensus 352 -ED----DLVtVwSf~erRV 366 (636)
T KOG2394|consen 352 -ED----DLVTVWSFEERRV 366 (636)
T ss_pred -Cc----ceEEEEEeccceE
Confidence 33 1455676665443
No 236
>PF13412 HTH_24: Winged helix-turn-helix DNA-binding; PDB: 1I1G_B 2IA0_B 3I4P_A 2GQQ_A 2L4A_A 2CFX_B 2DBB_B 2EFO_A 2EFQ_A 2PN6_A ....
Probab=28.82 E-value=58 Score=24.19 Aligned_cols=38 Identities=11% Similarity=0.284 Sum_probs=28.4
Q ss_pred hhHHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 997 GDLIESFLDLSRTRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 997 Gdll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
-.+|....+-+.-.+.++|+.+|.+...+.+.|.+|..
T Consensus 6 ~~Il~~l~~~~~~t~~ela~~~~is~~tv~~~l~~L~~ 43 (48)
T PF13412_consen 6 RKILNYLRENPRITQKELAEKLGISRSTVNRYLKKLEE 43 (48)
T ss_dssp HHHHHHHHHCTTS-HHHHHHHHTS-HHHHHHHHHHHHH
T ss_pred HHHHHHHHHcCCCCHHHHHHHhCCCHHHHHHHHHHHHH
Confidence 34565666667788999999999999999888887753
No 237
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=28.80 E-value=5.3e+02 Score=30.68 Aligned_cols=67 Identities=19% Similarity=0.395 Sum_probs=43.7
Q ss_pred CCEEEEEEcCCeEEEEEEcCcEEEEEEe-----ccC-CceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCe
Q 001655 446 ASQVLLATGGGHLVYLEIGDGILTEVKH-----AQL-EYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNL 518 (1036)
Q Consensus 446 ~~~vvv~~~~~~~~~l~~~~~~l~~~~~-----~~l-~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~ 518 (1036)
+..+.|+.+++.+-+-++..+.+.+... .+. ...|..+.+.|+. .+.++++.+ |.+|++|++.....
T Consensus 640 ~~rLAVa~ddg~i~lWr~~a~gl~e~~~tPe~~lt~h~eKI~slRfHPLA-----advLa~asy-d~Ti~lWDl~~~~~ 712 (1012)
T KOG1445|consen 640 DERLAVATDDGQINLWRLTANGLPENEMTPEKILTIHGEKITSLRFHPLA-----ADVLAVASY-DSTIELWDLANAKL 712 (1012)
T ss_pred hHHeeecccCceEEEEEeccCCCCcccCCcceeeecccceEEEEEecchh-----hhHhhhhhc-cceeeeeehhhhhh
Confidence 4467788878887776665433333211 111 2457777776653 678889988 99999999976443
No 238
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=28.57 E-value=8.5e+02 Score=27.08 Aligned_cols=162 Identities=17% Similarity=0.219 Sum_probs=80.1
Q ss_pred CCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEE-EeCCCcEEEEEEecCCCccccceeeecCccceEEEEE
Q 001655 505 DISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLC-ALGDGHLLNFLLNMKTGELTDRKKVSLGTQPITLRTF 583 (1036)
Q Consensus 505 ~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~v-gl~~G~l~~y~~~~~~~~l~~~~~~~lG~~pv~l~~~ 583 (1036)
.-.|.||+..-..++.+-....+.+ .++.+.+.+ ..++. +-.|+.++.|...... ..+++.++-++=.+. +
T Consensus 166 Ge~i~IWD~~R~~Pv~smswG~Dti-~svkfNpvE--TsILas~~sDrsIvLyD~R~~~----Pl~KVi~~mRTN~Is-w 237 (433)
T KOG0268|consen 166 GEQIDIWDEQRDNPVSSMSWGADSI-SSVKFNPVE--TSILASCASDRSIVLYDLRQAS----PLKKVILTMRTNTIC-W 237 (433)
T ss_pred CceeeecccccCCccceeecCCCce-eEEecCCCc--chheeeeccCCceEEEecccCC----ccceeeeecccccee-c
Confidence 3468888876555554444433211 233333322 33444 4479999999876532 122333443321111 1
Q ss_pred EeCCceEEEEEcCCceEEEecCCcEEEeeec--cccceeeecccCCCCCCeEEEEe-CCeEEEEEEcCCCC---eEEEEE
Q 001655 584 SSKNTTHVFAASDRPTVIYSSNKKLLYSNVN--LKEVSHMCPFNSAAFPDSLAIAK-EGELTIGTIDDIQK---LHIRSI 657 (1036)
Q Consensus 584 ~~~~~~~v~~~~~~p~~i~~~~~~~~~~~~~--~~~i~~~~~f~~~~~~~~l~~~~-~~~l~i~~l~~~~~---~~~~~i 657 (1036)
+.+...|+.++.-+=+|..+-|..-.|++ -+.+.++...+-...++=|+..+ +..++|........ ++.++.
T Consensus 238 --nPeafnF~~a~ED~nlY~~DmR~l~~p~~v~~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~~~~~~SRdiYhtkRM 315 (433)
T KOG0268|consen 238 --NPEAFNFVAANEDHNLYTYDMRNLSRPLNVHKDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFPVNHGHSRDIYHTKRM 315 (433)
T ss_pred --CccccceeeccccccceehhhhhhcccchhhcccceeEEEeccCCCcchhccccccceEEEeecCCCcchhhhhHhhh
Confidence 12456777777666666554443223443 23444444433333333344444 78889988876532 333332
Q ss_pred eCCCccceEEEecCCCEEEEEEe
Q 001655 658 PLGEHPRRICHQEQSRTFAICSL 680 (1036)
Q Consensus 658 ~l~~tp~~i~y~~~~~~~~v~~~ 680 (1036)
. ..-.+.|+.+++ |++..+
T Consensus 316 q---~V~~Vk~S~Dsk-yi~SGS 334 (433)
T KOG0268|consen 316 Q---HVFCVKYSMDSK-YIISGS 334 (433)
T ss_pred h---eeeEEEEecccc-EEEecC
Confidence 2 223456766655 454444
No 239
>PF13404 HTH_AsnC-type: AsnC-type helix-turn-helix domain; PDB: 2ZNY_E 2ZNZ_G 1RI7_A 2CYY_A 2E1C_A 2VC1_B 2QZ8_A 2W29_C 2IVM_B 2VBX_B ....
Probab=28.27 E-value=51 Score=24.00 Aligned_cols=39 Identities=18% Similarity=0.379 Sum_probs=26.9
Q ss_pred EehhHHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHHh
Q 001655 995 LDGDLIESFLDLSRTRMDEISKTMNVSVEELCKRVEELT 1033 (1036)
Q Consensus 995 iDGdll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l~ 1033 (1036)
+|-.+|..+..=+..--.+|++.+|++...+.+-+..|+
T Consensus 4 ~D~~Il~~Lq~d~r~s~~~la~~lglS~~~v~~Ri~rL~ 42 (42)
T PF13404_consen 4 LDRKILRLLQEDGRRSYAELAEELGLSESTVRRRIRRLE 42 (42)
T ss_dssp HHHHHHHHHHH-TTS-HHHHHHHHTS-HHHHHHHHHHHH
T ss_pred HHHHHHHHHHHcCCccHHHHHHHHCcCHHHHHHHHHHhC
Confidence 355566665555666678999999999999988877664
No 240
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=28.19 E-value=5.3e+02 Score=31.13 Aligned_cols=112 Identities=13% Similarity=0.155 Sum_probs=62.7
Q ss_pred ecCceeEeccccC-eEEEEEC-CEEEEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEEeccC
Q 001655 769 TKGAVYSLNAFNG-KLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIYKHEE 846 (1036)
Q Consensus 769 ~~g~v~~i~~~~g-~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~~~~~ 846 (1036)
+...|.+++.+.+ .++.|.+ .-|+.+.++ | ..|...-.+..++|.+++ ..++.++|..--++-. -.|+.+
T Consensus 178 HtD~VRgL~vl~~~~flScsNDg~Ir~w~~~----g-e~l~~~~ghtn~vYsis~-~~~~~~Ivs~gEDrtl-riW~~~- 249 (745)
T KOG0301|consen 178 HTDCVRGLAVLDDSHFLSCSNDGSIRLWDLD----G-EVLLEMHGHTNFVYSISM-ALSDGLIVSTGEDRTL-RIWKKD- 249 (745)
T ss_pred chhheeeeEEecCCCeEeecCCceEEEEecc----C-ceeeeeeccceEEEEEEe-cCCCCeEEEecCCceE-EEeecC-
Confidence 6778999999976 5555544 445554431 2 234333333444455442 3345555555555431 224433
Q ss_pred CeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCCCC
Q 001655 847 GAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNSEG 890 (1036)
Q Consensus 847 ~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~~~ 890 (1036)
.....-.-|. ..+-++.+|.++.++++-++|-+++|...+..
T Consensus 250 -e~~q~I~lPt-tsiWsa~~L~NgDIvvg~SDG~VrVfT~~k~R 291 (745)
T KOG0301|consen 250 -ECVQVITLPT-TSIWSAKVLLNGDIVVGGSDGRVRVFTVDKDR 291 (745)
T ss_pred -ceEEEEecCc-cceEEEEEeeCCCEEEeccCceEEEEEecccc
Confidence 1211111121 13337888988888888899999999887543
No 241
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=28.19 E-value=1.7e+02 Score=31.77 Aligned_cols=114 Identities=18% Similarity=0.165 Sum_probs=54.0
Q ss_pred eec--CCCCCEEEEEEEecCCc--ceEEEEEE-----eccCCceeeccccccccCCCCCEEEec---CCCC--cceEEEe
Q 001655 116 FLY--GCAKPTIVVLYQDNKDA--RHVKTYEV-----ALKDKDFVEGPWSQNNLDNGADLLIPV---PPPL--CGVLIIG 181 (1036)
Q Consensus 116 FL~--~~~~ptlavL~~~~~~~--~~l~~~~~-----~~~~~~~~~~~~~~~~lp~~~~~lip~---p~~~--~G~lv~~ 181 (1036)
||| .+..|++++|+...... .-+...+. +.......+.++.+..+|-.-+++=|. |+|. -|.|.++
T Consensus 248 flhl~s~~dp~~~~~~ke~~~~~ql~~~cLsf~p~~~~a~~~~~se~~YE~~~~pv~~~~lkp~tD~pnPk~g~g~lafs 327 (447)
T KOG4497|consen 248 FLHLCSYHDPTLHLLEKETFSIVQLLHHCLSFTPTDLEAHIWEESETIYEQQMTPVKVHKLKPPTDFPNPKCGAGKLAFS 327 (447)
T ss_pred hccchhccCchhhhhhhhhcchhhhcccccccCCCccccCccccchhhhhhhhcceeeecccCCCCCCCcccccceeeec
Confidence 676 47889988888754221 11111111 111111122344555566555555554 4443 4577777
Q ss_pred CceEEEEcCCc--eee-------------eccCcceeeEEEEEecCCCEEEEEcCccCEEEEEE
Q 001655 182 EETIVYCSANA--FKA-------------IPIRPSITKAYGRVDADGSRYLLGDHAGLLHLLVI 230 (1036)
Q Consensus 182 ~~~i~y~~~~~--~~~-------------~~~~~~~~~~~~~~~~~~~~~ll~~~~G~l~~l~l 230 (1036)
.++-.-...+. +.+ +-+....+.++.+ |...-++++++..-+||+-..
T Consensus 328 ~Ds~y~aTrnd~~PnalW~Wdlq~l~l~avLiQk~piraf~W-dP~~prL~vctg~srLY~W~p 390 (447)
T KOG4497|consen 328 CDSTYAATRNDKYPNALWLWDLQNLKLHAVLIQKHPIRAFEW-DPGRPRLVVCTGKSRLYFWAP 390 (447)
T ss_pred CCceEEeeecCCCCceEEEEechhhhhhhhhhhccceeEEEe-CCCCceEEEEcCCceEEEEcC
Confidence 77643333222 000 0011112333332 334467788877777776654
No 242
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=27.94 E-value=1.9e+02 Score=34.24 Aligned_cols=123 Identities=15% Similarity=0.161 Sum_probs=66.5
Q ss_pred eeeCCCCCcEEEEEeCCCEEEEEEcCCeEEEEEEcCcEEEEEEec----cCCceeEEEEcCCCCCCCCcccEEEEEEecC
Q 001655 430 EWKSPPGYSVNVATANASQVLLATGGGHLVYLEIGDGILTEVKHA----QLEYEISCLDINPIGENPSYSQIAAVGMWTD 505 (1036)
Q Consensus 430 ~w~~~~~~~I~~as~~~~~vvv~~~~~~~~~l~~~~~~l~~~~~~----~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~ 505 (1036)
.|.+|.+.+-..|.-....+.++.++|.+.++....-.+. .++. .+.+.-.-+++..++ .+..+|.--.|
T Consensus 48 ~p~pPf~~sFs~~~n~eHiLavadE~G~i~l~dt~~~~fr-~ee~~lk~~~aH~nAifDl~wap-----ge~~lVsasGD 121 (720)
T KOG0321|consen 48 LPVPPFADSFSAAPNKEHILAVADEDGGIILFDTKSIVFR-LEERQLKKPLAHKNAIFDLKWAP-----GESLLVSASGD 121 (720)
T ss_pred CCCCCccccccCCCCccceEEEecCCCceeeecchhhhcc-hhhhhhcccccccceeEeeccCC-----CceeEEEccCC
Confidence 4556543222222233556777777777776654331222 1111 122222334554333 34455555558
Q ss_pred CEEEEEECCCCCeeEE-ecCCCccCceeEEeeeecCeEEEEE-EeCCCcEEEEEEec
Q 001655 506 ISVRIFSLPDLNLITK-EHLGGEIIPRSVLLCAFEGISYLLC-ALGDGHLLNFLLNM 560 (1036)
Q Consensus 506 ~~i~i~~l~~l~~v~~-~~l~~~~~p~si~~~~~~~~~~L~v-gl~~G~l~~y~~~~ 560 (1036)
.+++.|++..-+++.. ..+.......|+++...+ +.+|| |-+||.++.+....
T Consensus 122 sT~r~Wdvk~s~l~G~~~~~GH~~SvkS~cf~~~n--~~vF~tGgRDg~illWD~R~ 176 (720)
T KOG0321|consen 122 STIRPWDVKTSRLVGGRLNLGHTGSVKSECFMPTN--PAVFCTGGRDGEILLWDCRC 176 (720)
T ss_pred ceeeeeeeccceeecceeecccccccchhhhccCC--CcceeeccCCCcEEEEEEec
Confidence 8999999987555432 223333345677776643 44454 99999999988654
No 243
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=27.90 E-value=2.5e+02 Score=32.72 Aligned_cols=89 Identities=17% Similarity=0.294 Sum_probs=0.0
Q ss_pred cCcEEEEecCCccceeeeeCCCCCcEEE-------EEeCCCEEEEEEcCCeEEEEEEcC---cE----EEEEEeccCCce
Q 001655 414 SGSVRLVSSTSRELRNEWKSPPGYSVNV-------ATANASQVLLATGGGHLVYLEIGD---GI----LTEVKHAQLEYE 479 (1036)
Q Consensus 414 ~~~i~l~~~~~~~~~~~w~~~~~~~I~~-------as~~~~~vvv~~~~~~~~~l~~~~---~~----l~~~~~~~l~~~ 479 (1036)
++++.-++.+.++.+.+|+...+...+. |...+.+-+|.++++.+ |++|+ +. ..+-+...-...
T Consensus 355 ~~~l~klDIE~GKIVeEWk~~~di~mv~~t~d~K~~Ql~~e~TlvGLs~n~v--friDpRv~~~~kl~~~q~kqy~~k~n 432 (644)
T KOG2395|consen 355 QDKLYKLDIERGKIVEEWKFEDDINMVDITPDFKFAQLTSEQTLVGLSDNSV--FRIDPRVQGKNKLAVVQSKQYSTKNN 432 (644)
T ss_pred cCcceeeecccceeeeEeeccCCcceeeccCCcchhcccccccEEeecCCce--EEecccccCcceeeeeeccccccccc
Q ss_pred eEEEEcCCCCCCCCcccEEEEEEecCCEEEEEE
Q 001655 480 ISCLDINPIGENPSYSQIAAVGMWTDISVRIFS 512 (1036)
Q Consensus 480 is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~ 512 (1036)
-+|++-.. +.+++||.- +|.|++|+
T Consensus 433 Fsc~aTT~-------sG~IvvgS~-~GdIRLYd 457 (644)
T KOG2395|consen 433 FSCFATTE-------SGYIVVGSL-KGDIRLYD 457 (644)
T ss_pred cceeeecC-------CceEEEeec-CCcEEeeh
No 244
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=27.83 E-value=9.3e+02 Score=27.27 Aligned_cols=197 Identities=13% Similarity=0.118 Sum_probs=96.6
Q ss_pred cceEEEeecCCCCCcccEEEEEecCceEEE-EecCCCCeeeeeecCeeccccceeeeecCCCeEEEEe--cCcEEEEecC
Q 001655 347 IKGMWSLRSSTDDPFDTFLVVSFISETRIL-AMNLEDELEETEIEGFCSQTQTLFCHDAIYNQLVQVT--SGSVRLVSST 423 (1036)
Q Consensus 347 ~~~iw~l~~~~~~~~~~~lv~S~~~~T~vl-~~~~~~~~~e~~~~~f~~~~~Tl~~~~~~~~~~vQVt--~~~i~l~~~~ 423 (1036)
...+|.+..+. +..||..+..+.|.++ .+..+..++-. ....-...+-++..--++.+.+--+ .+.+++.+..
T Consensus 224 tdEVWfl~FS~---nGkyLAsaSkD~Taiiw~v~~d~~~kl~-~tlvgh~~~V~yi~wSPDdryLlaCg~~e~~~lwDv~ 299 (519)
T KOG0293|consen 224 TDEVWFLQFSH---NGKYLASASKDSTAIIWIVVYDVHFKLK-KTLVGHSQPVSYIMWSPDDRYLLACGFDEVLSLWDVD 299 (519)
T ss_pred CCcEEEEEEcC---CCeeEeeccCCceEEEEEEecCcceeee-eeeecccCceEEEEECCCCCeEEecCchHheeeccCC
Confidence 35899998853 4579988888888654 44444333221 1111111222222222343322222 2335555655
Q ss_pred CccceeeeeCCCCCcEEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEeccCCceeEEEEcCCCCCCCCcccEEEEE
Q 001655 424 SRELRNEWKSPPGYSVNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHAQLEYEISCLDINPIGENPSYSQIAAVG 501 (1036)
Q Consensus 424 ~~~~~~~w~~~~~~~I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg 501 (1036)
++..........+.+.++++-. +.-++....++.++....|...+..=+-. -...|.++++.+ + +.+++..
T Consensus 300 tgd~~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn~~~~W~gv-r~~~v~dlait~--D----gk~vl~v 372 (519)
T KOG0293|consen 300 TGDLRHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGNILGNWEGV-RDPKVHDLAITY--D----GKYVLLV 372 (519)
T ss_pred cchhhhhcccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcchhhccccc-ccceeEEEEEcC--C----CcEEEEE
Confidence 5444433222113455566533 33455555566676666653211110000 114578888853 2 3454444
Q ss_pred EecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEEEe
Q 001655 502 MWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFLLN 559 (1036)
Q Consensus 502 ~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~~~ 559 (1036)
+- +..+.+|+..+..-... ...+.+..|..+. ++..+.++.+.+-.+..+.+.
T Consensus 373 ~~-d~~i~l~~~e~~~dr~l--ise~~~its~~iS--~d~k~~LvnL~~qei~LWDl~ 425 (519)
T KOG0293|consen 373 TV-DKKIRLYNREARVDRGL--ISEEQPITSFSIS--KDGKLALVNLQDQEIHLWDLE 425 (519)
T ss_pred ec-ccceeeechhhhhhhcc--ccccCceeEEEEc--CCCcEEEEEcccCeeEEeecc
Confidence 44 88999999875321100 1111223344333 345667777777777766655
No 245
>PF08662 eIF2A: Eukaryotic translation initiation factor eIF2A; InterPro: IPR013979 This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins.
Probab=27.80 E-value=6.4e+02 Score=25.40 Aligned_cols=130 Identities=14% Similarity=0.179 Sum_probs=62.8
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCC--eEEEEEEEEecCceeEecc--ccCeEEEEEC---CEEEEEEeeecCC
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDG--KLQLIAEKETKGAVYSLNA--FNGKLLAAIN---QKIQLYKWMLRDD 801 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~--kl~~~~~~~~~g~v~~i~~--~~g~Lv~~~g---~~l~v~~~~~~~~ 801 (1036)
..+++|=+...........-|..-+|.++.. ..+.+ +.+-+|+|.+++= -+.+++++.| .++.+|+.+
T Consensus 17 G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i-~l~~~~~I~~~~WsP~g~~favi~g~~~~~v~lyd~~---- 91 (194)
T PF08662_consen 17 GDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESI-ELKKEGPIHDVAWSPNGNEFAVIYGSMPAKVTLYDVK---- 91 (194)
T ss_pred CCEEEEEEEEeeccCcceEEeeEEEEEEecCCCcccee-eccCCCceEEEEECcCCCEEEEEEccCCcccEEEcCc----
Confidence 3455555542211112233466667766532 22222 2334678888862 2456766655 478888863
Q ss_pred CccchhcccccccceEEEEEEEeCCEEEEEecccc---EEEEEEeccCCeEEEEeccCCcceeEEEEEeeCce
Q 001655 802 GTRELQSECGHHGHILALYVQTRGDFIVVGDLMKS---ISLLIYKHEEGAIEERARDYNANWMSAVEILDDDI 871 (1036)
Q Consensus 802 ~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~S---v~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~ 871 (1036)
+ +.+... .......+.-+..|+++++|..-.. +.| |+.++ ...++....+ .++.++.-.++.
T Consensus 92 ~-~~i~~~--~~~~~n~i~wsP~G~~l~~~g~~n~~G~l~~--wd~~~--~~~i~~~~~~-~~t~~~WsPdGr 156 (194)
T PF08662_consen 92 G-KKIFSF--GTQPRNTISWSPDGRFLVLAGFGNLNGDLEF--WDVRK--KKKISTFEHS-DATDVEWSPDGR 156 (194)
T ss_pred c-cEeEee--cCCCceEEEECCCCCEEEEEEccCCCcEEEE--EECCC--CEEeeccccC-cEEEEEEcCCCC
Confidence 1 111111 0112233444557889998875432 555 45443 3334433332 245555544444
No 246
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=27.77 E-value=8.8e+02 Score=26.98 Aligned_cols=72 Identities=17% Similarity=0.244 Sum_probs=44.4
Q ss_pred cEEEEEeC--CCEEEE-EEcCCeEEEEEEcCcEE-EEEEeccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEEC
Q 001655 438 SVNVATAN--ASQVLL-ATGGGHLVYLEIGDGIL-TEVKHAQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSL 513 (1036)
Q Consensus 438 ~I~~as~~--~~~vvv-~~~~~~~~~l~~~~~~l-~~~~~~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l 513 (1036)
.|..|..+ +.+++. ...++.+..-++..+.. ..+ ...+.-|..++|.| .+.|++= +-.|+++++|++
T Consensus 293 ~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg~cL~tL--~ghdnwVr~~af~p------~Gkyi~S-caDDktlrvwdl 363 (406)
T KOG0295|consen 293 SISEATGSTNGGQVLGSGSRDKTIKIWDVSTGMCLFTL--VGHDNWVRGVAFSP------GGKYILS-CADDKTLRVWDL 363 (406)
T ss_pred chhhccCCCCCccEEEeecccceEEEEeccCCeEEEEE--ecccceeeeeEEcC------CCeEEEE-EecCCcEEEEEe
Confidence 35555533 334444 44567777777765432 222 24567788888865 3556654 444999999999
Q ss_pred CCCCe
Q 001655 514 PDLNL 518 (1036)
Q Consensus 514 ~~l~~ 518 (1036)
...+.
T Consensus 364 ~~~~c 368 (406)
T KOG0295|consen 364 KNLQC 368 (406)
T ss_pred cccee
Confidence 87544
No 247
>TIGR02276 beta_rpt_yvtn 40-residue YVTN family beta-propeller repeat. This repeat of about 40 amino acids is found in up to 14 copies per protein. Archaea Methanosarcina mazei and Methanosarcina acetivorans each have over 10 genes that encode tandem copies of this repeat, which is also found in other species. PSIPRED predicts with high confidence that each 40-residue repeats contains four beta strands. This model overlaps somewhat with the NHL repeat (Pfam pfam01436) and also shows sequence similarity to the WD domain, G-beta repeat (Pfam pfam00400).
Probab=27.74 E-value=2.2e+02 Score=19.94 Aligned_cols=38 Identities=16% Similarity=0.066 Sum_probs=26.9
Q ss_pred ccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEE
Q 001655 495 SQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVL 534 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~ 534 (1036)
...+.|+.|.+++|.+++..+.+.+...... ..|+.+.
T Consensus 3 ~~~lyv~~~~~~~v~~id~~~~~~~~~i~vg--~~P~~i~ 40 (42)
T TIGR02276 3 GTKLYVTNSGSNTVSVIDTATNKVIATIPVG--GYPFGVA 40 (42)
T ss_pred CCEEEEEeCCCCEEEEEECCCCeEEEEEECC--CCCceEE
Confidence 4578888898899999998777766554443 3455554
No 248
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=27.10 E-value=1.2e+03 Score=28.32 Aligned_cols=183 Identities=17% Similarity=0.211 Sum_probs=94.5
Q ss_pred EecCceeEeccccC-eEEEE-ECCEEEEEEeeecCCCccchhcccccccceEEE-EEEEe-CCEEEEEeccccEEEEEEe
Q 001655 768 ETKGAVYSLNAFNG-KLLAA-INQKIQLYKWMLRDDGTRELQSECGHHGHILAL-YVQTR-GDFIVVGDLMKSISLLIYK 843 (1036)
Q Consensus 768 ~~~g~v~~i~~~~g-~Lv~~-~g~~l~v~~~~~~~~~~~~L~~~~~~~~~~~~~-~l~~~-~~~I~vgD~~~Sv~~~~~~ 843 (1036)
.+++-|-|+...+. .++.+ -.++++++.. + ++.-. ++.+..++ .+... ++.++.|-+-+.+.++ +
T Consensus 99 gH~snVC~ls~~~~~~~iSgSWD~TakvW~~-----~--~l~~~--l~gH~asVWAv~~l~e~~~vTgsaDKtIklW--k 167 (745)
T KOG0301|consen 99 GHKSNVCSLSIGEDGTLISGSWDSTAKVWRI-----G--ELVYS--LQGHTASVWAVASLPENTYVTGSADKTIKLW--K 167 (745)
T ss_pred ccccceeeeecCCcCceEecccccceEEecc-----h--hhhcc--cCCcchheeeeeecCCCcEEeccCcceeeec--c
Confidence 45566666665543 43332 3356666553 1 12211 23443333 23333 5678889999998765 3
Q ss_pred ccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCCCCCCccccc--ceeEEEEEEcCCccceEE-eeeee
Q 001655 844 HEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNSEGATDEERG--RLEVVGEYHLGEFVNRFR-HGSLV 920 (1036)
Q Consensus 844 ~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~~~~~~~~~~--~L~~~~~~~lg~~v~~~~-~~~l~ 920 (1036)
. +..+..+.. +.--|.++.+|++..++.++.+|.|.....+.+......++ -.-..+.+|=+..|.+-- -+.++
T Consensus 168 ~-~~~l~tf~g--HtD~VRgL~vl~~~~flScsNDg~Ir~w~~~ge~l~~~~ghtn~vYsis~~~~~~~Ivs~gEDrtlr 244 (745)
T KOG0301|consen 168 G-GTLLKTFSG--HTDCVRGLAVLDDSHFLSCSNDGSIRLWDLDGEVLLEMHGHTNFVYSISMALSDGLIVSTGEDRTLR 244 (745)
T ss_pred C-Cchhhhhcc--chhheeeeEEecCCCeEeecCCceEEEEeccCceeeeeeccceEEEEEEecCCCCeEEEecCCceEE
Confidence 2 222222222 33446788899988999999999999888754322111111 111222233222221110 00111
Q ss_pred ec----------CCC-----CCCCCcceEEEEccccceEEEEecC--hhHHHHHHHHHHHH
Q 001655 921 MR----------LPD-----SDVGQIPTVIFGTVNGVIGVIASLP--HEQYLFLEKLQTNL 964 (1036)
Q Consensus 921 ~~----------~~~-----~~~~~~~~il~~t~~GsIg~l~~l~--~~~~~~L~~lq~~l 964 (1036)
+. .|. .....+..|+.|++||-|..++.-. ...-+.|..++..+
T Consensus 245 iW~~~e~~q~I~lPttsiWsa~~L~NgDIvvg~SDG~VrVfT~~k~R~As~evl~afd~~v 305 (745)
T KOG0301|consen 245 IWKKDECVQVITLPTTSIWSAKVLLNGDIVVGGSDGRVRVFTVDKDRKASDEVLKAFDAEV 305 (745)
T ss_pred EeecCceEEEEecCccceEEEEEeeCCCEEEeccCceEEEEEecccccCCHHHHHHHHHHH
Confidence 10 011 0112356889999999999988762 12234566666666
No 249
>PF13543 KSR1-SAM: SAM like domain present in kinase suppressor RAS 1
Probab=27.03 E-value=1.1e+02 Score=28.56 Aligned_cols=39 Identities=23% Similarity=0.290 Sum_probs=34.8
Q ss_pred hhHHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHHhcc
Q 001655 997 GDLIESFLDLSRTRMDEISKTMNVSVEELCKRVEELTRL 1035 (1036)
Q Consensus 997 Gdll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l~~~ 1035 (1036)
.--++..++|++.+.++++++.|.+.||..+....++.|
T Consensus 90 ~~tLe~Llemsd~el~~~l~~~g~~~EE~rRL~~Al~~L 128 (129)
T PF13543_consen 90 VLTLEALLEMSDEELKEILNRCGAREEECRRLCRALSNL 128 (129)
T ss_pred hcCHHHHHhCCHHHHHHHHHHhCCCHHHHHHHHHHHHhc
Confidence 446788899999999999999999999999999888765
No 250
>PF15525 DUF4652: Domain of unknown function (DUF4652)
Probab=26.31 E-value=5.7e+02 Score=25.64 Aligned_cols=92 Identities=21% Similarity=0.221 Sum_probs=55.8
Q ss_pred CCCceeeEEEEEEeCCCceEEEEEECCCCCeEeE--EEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEE
Q 001655 685 CAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCS--ILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQ 762 (1036)
Q Consensus 685 ~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~s--i~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~ 762 (1036)
+.+++..+.|-+.|..+.+. .++..++.+.-.+ =..| + ++..=++++|-++- ..+..|-||+|.+..+.++
T Consensus 81 ~a~eEgiGkIYIkn~~~~~~-~~L~i~~~~~k~sPK~i~W-i-DD~~L~vIIG~a~G----TvS~GGnLy~~nl~tg~~~ 153 (200)
T PF15525_consen 81 EAEEEGIGKIYIKNLNNNNW-WSLQIDQNEEKYSPKYIEW-I-DDNNLAVIIGYAHG----TVSKGGNLYKYNLNTGNLT 153 (200)
T ss_pred ccccccceeEEEEecCCCce-EEEEecCcccccCCceeEE-e-cCCcEEEEEccccc----eEccCCeEEEEEccCCcee
Confidence 34455677888888655444 3344444432111 1123 2 22334455565542 4578899999999999998
Q ss_pred EEEEE-EecCceeEeccccCeE
Q 001655 763 LIAEK-ETKGAVYSLNAFNGKL 783 (1036)
Q Consensus 763 ~~~~~-~~~g~v~~i~~~~g~L 783 (1036)
.++.. +-+..|-++...++.|
T Consensus 154 ~ly~~~dkkqQVis~e~~gd~L 175 (200)
T PF15525_consen 154 ELYEWKDKKQQVISAEKNGDNL 175 (200)
T ss_pred EeeeccccceeEEEEEEeCCEE
Confidence 88875 4577777777666665
No 251
>PF08728 CRT10: CRT10; InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance [].
Probab=26.13 E-value=4e+02 Score=32.80 Aligned_cols=149 Identities=15% Similarity=0.139 Sum_probs=76.5
Q ss_pred CCccEEEEEeCcCcEEEEEEeCCCCcEEEEE---eeeccCCCCcc------CCCCCeEEEC--CCCCEEEEEecCCeEEE
Q 001655 21 EAQDFLFIATERYKFCVLQWDAESSELITRA---MGDVSDRIGRP------TDNGQIGIID--PDCRLIGLHLYDGLFKV 89 (1036)
Q Consensus 21 ~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s---~~~~~~~~~~~------~~~~~~l~vd--p~~r~~~~~~~~~~~~i 89 (1036)
...+.|++++|+|.+.+.+-..-...+...+ -+......-.| ..+-=-++++ ...|.+|++.....+.|
T Consensus 112 g~~EVLl~c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f~~~v~~SaWGLdIh~~~~~rlIAVSsNs~~VTV 191 (717)
T PF08728_consen 112 GGEEVLLLCTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFFHLRVGASAWGLDIHDYKKSRLIAVSSNSQEVTV 191 (717)
T ss_pred CCeeEEEEEecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCeEeecCCceeEEEEEecCcceEEEEecCCceEEE
Confidence 4679999999999987664321000000000 00000000001 0111135666 88999999999888888
Q ss_pred EeCCCC-CccccceecccCCceEEEEEeecCCCCCE--EEEEEEecCCcceEEEEEEecc--CC-----ceeeccccccc
Q 001655 90 IPFDNK-GQLKEAFNIRLEELQVLDIKFLYGCAKPT--IVVLYQDNKDARHVKTYEVALK--DK-----DFVEGPWSQNN 159 (1036)
Q Consensus 90 lp~~~~-~~~~~~~~~~l~~~~i~d~~FL~~~~~pt--lavL~~~~~~~~~l~~~~~~~~--~~-----~~~~~~~~~~~ 159 (1036)
+-+... +.....-... ..+||=.++|++....|. .-+.+.+..+. +.++++.+. .. .+....+....
T Consensus 192 Faf~l~~~r~~~~~s~~-~~hNIP~VSFl~~~~d~~G~v~v~a~dI~G~--v~~~~I~~~~~~gp~~~i~~~~~~~~s~~ 268 (717)
T PF08728_consen 192 FAFALVDERFYHVPSHQ-HSHNIPNVSFLDDDLDPNGHVKVVATDISGE--VWTFKIKFKEGRGPFRRIDFESPILDSRF 268 (717)
T ss_pred EEEeccccccccccccc-cccCCCeeEeecCCCCCccceEEEEEeccCc--EEEEEEEEeeccCcccccccccccccccc
Confidence 877542 1110000111 236899999998764443 46666766543 555555332 21 11111122222
Q ss_pred -cCCCCCEEEecCC
Q 001655 160 -LDNGADLLIPVPP 172 (1036)
Q Consensus 160 -lp~~~~~lip~p~ 172 (1036)
++.++..++|++.
T Consensus 269 ~~~e~~WTV~~L~~ 282 (717)
T PF08728_consen 269 FLSEDCWTVTPLSS 282 (717)
T ss_pred ccccCceEEEEcCH
Confidence 2677777888763
No 252
>PLN02153 epithiospecifier protein
Probab=25.78 E-value=9.4e+02 Score=26.65 Aligned_cols=137 Identities=12% Similarity=0.096 Sum_probs=64.7
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEe-cCc----eeEeccccCeEEEEECC-------------E
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKET-KGA----VYSLNAFNGKLLAAINQ-------------K 790 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~-~g~----v~~i~~~~g~Lv~~~g~-------------~ 790 (1036)
..++++|-... ......+++|+...++.+.+..... .+| -.+.+.++++|++.-|. .
T Consensus 86 ~~iyv~GG~~~-----~~~~~~v~~yd~~t~~W~~~~~~~~~~~p~~R~~~~~~~~~~~iyv~GG~~~~~~~~~~~~~~~ 160 (341)
T PLN02153 86 TKLYIFGGRDE-----KREFSDFYSYDTVKNEWTFLTKLDEEGGPEARTFHSMASDENHVYVFGGVSKGGLMKTPERFRT 160 (341)
T ss_pred CEEEEECCCCC-----CCccCcEEEEECCCCEEEEeccCCCCCCCCCceeeEEEEECCEEEEECCccCCCccCCCcccce
Confidence 46777775321 1123467888887777776654311 111 22344557776654442 3
Q ss_pred EEEEEeeecCCCccchhcccccc-cceEEEEEEEeCCEEEE-Eecc-----------ccEEEEEEeccCCeEEEEec---
Q 001655 791 IQLYKWMLRDDGTRELQSECGHH-GHILALYVQTRGDFIVV-GDLM-----------KSISLLIYKHEEGAIEERAR--- 854 (1036)
Q Consensus 791 l~v~~~~~~~~~~~~L~~~~~~~-~~~~~~~l~~~~~~I~v-gD~~-----------~Sv~~~~~~~~~~~l~~~a~--- 854 (1036)
+.+|+. ++ ..++.+...... ..-...++.+.++.|++ |-.. ..-.+..|+++.++...+..
T Consensus 161 v~~yd~--~~-~~W~~l~~~~~~~~~r~~~~~~~~~~~iyv~GG~~~~~~~gG~~~~~~~~v~~yd~~~~~W~~~~~~g~ 237 (341)
T PLN02153 161 IEAYNI--AD-GKWVQLPDPGENFEKRGGAGFAVVQGKIWVVYGFATSILPGGKSDYESNAVQFFDPASGKWTEVETTGA 237 (341)
T ss_pred EEEEEC--CC-CeEeeCCCCCCCCCCCCcceEEEECCeEEEEeccccccccCCccceecCceEEEEcCCCcEEeccccCC
Confidence 444443 21 122211110000 00011234455666654 3211 11135568888888877753
Q ss_pred cCCcceeEEEEEeeCceEE
Q 001655 855 DYNANWMSAVEILDDDIYL 873 (1036)
Q Consensus 855 D~~~~~~~~~~~l~~~~~l 873 (1036)
-+.+|...++..+++.-++
T Consensus 238 ~P~~r~~~~~~~~~~~iyv 256 (341)
T PLN02153 238 KPSARSVFAHAVVGKYIII 256 (341)
T ss_pred CCCCcceeeeEEECCEEEE
Confidence 2556665555555543333
No 253
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=25.65 E-value=1.3e+03 Score=28.13 Aligned_cols=188 Identities=15% Similarity=0.215 Sum_probs=88.5
Q ss_pred ceEEEEEcCCceEEEecCC-cEEEeeec--cccceeeecccCCCCCCeEEE-EeCCeEEEEEEcCCCCeEEEEEeCCCcc
Q 001655 588 TTHVFAASDRPTVIYSSNK-KLLYSNVN--LKEVSHMCPFNSAAFPDSLAI-AKEGELTIGTIDDIQKLHIRSIPLGEHP 663 (1036)
Q Consensus 588 ~~~v~~~~~~p~~i~~~~~-~~~~~~~~--~~~i~~~~~f~~~~~~~~l~~-~~~~~l~i~~l~~~~~~~~~~i~l~~tp 663 (1036)
..+.++.|..|.+...+.. .+....+. ...+.+..-+.....+-.++. ..++.+.+-++....-..+..++. ..-
T Consensus 24 ~~~~vafGa~~~Iav~dp~k~~i~t~l~GH~a~VnC~~~l~~s~~~a~~vsG~sD~~v~lW~l~~~~~~~i~~~~g-~~~ 102 (764)
T KOG1063|consen 24 PGGLVAFGAGPAIAVADPEKILIVTTLDGHVARVNCVHWLPTSEIVAEMVSGDSDGRVILWKLRDEYLIKIYTIQG-HCK 102 (764)
T ss_pred ccceEEecCCceEEEeCcccceeEEeccCCccceEEEEEcccccccceEEEccCCCcEEEEEEeehheEEEEeecC-cce
Confidence 4566777777777665532 23334333 245666665533333323333 246778888887444445555655 233
Q ss_pred ceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCce--EEEEEECCCCCe-EeEEEEEEEcCCCceEEEEEeeeeC
Q 001655 664 RRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFE--FISTYPLDTFEY-GCSILSCSFSDDSNVYYCVGTAYVL 740 (1036)
Q Consensus 664 ~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~--~i~~~~~~~~E~-v~si~~~~l~~~~~~~i~VGT~~~~ 740 (1036)
.-++....... +.| .. ..+.+.+.|.+.-+ ..+.+.|+..|. ++|+... ++.+.-.+++|+...
T Consensus 103 ~~~cv~a~~~~--~~~-~~-------ad~~v~vw~~~~~e~~~~~~~rf~~k~~ipLcL~~~--~~~~~~lla~Ggs~~- 169 (764)
T KOG1063|consen 103 ECVCVVARSSV--MTC-KA-------ADGTVSVWDKQQDEVFLLAVLRFEIKEAIPLCLAAL--KNNKTFLLACGGSKF- 169 (764)
T ss_pred eEEEEEeeeeE--EEe-ec-------cCceEEEeecCCCceeeehheehhhhhHhhHHHhhh--ccCCcEEEEecCcce-
Confidence 33333332221 111 00 11344444443323 234445555554 2444433 233455677776542
Q ss_pred CCCCCCcceEEEEEEEeCCeEEEEEEEE-ecCceeEeccc----cCeEEEEECCE--EEEEEeee
Q 001655 741 PEENEPTKGRILVFIVEDGKLQLIAEKE-TKGAVYSLNAF----NGKLLAAINQK--IQLYKWML 798 (1036)
Q Consensus 741 ~~e~~~~~Gri~v~~i~~~kl~~~~~~~-~~g~v~~i~~~----~g~Lv~~~g~~--l~v~~~~~ 798 (1036)
++.+|.-...+++.+.+.+ +..-|.+|+-- +..++++.+|. |+++++..
T Consensus 170 ---------~v~~~s~~~d~f~~v~el~GH~DWIrsl~f~~~~~~~~~laS~SQD~yIRiW~i~~ 225 (764)
T KOG1063|consen 170 ---------VVDLYSSSADSFARVAELEGHTDWIRSLAFARLGGDDLLLASSSQDRYIRIWRIVL 225 (764)
T ss_pred ---------EEEEeccCCcceeEEEEeeccchhhhhhhhhccCCCcEEEEecCCceEEEEEEEEe
Confidence 3334433344555555432 34455555422 23556666654 45555543
No 254
>PF07569 Hira: TUP1-like enhancer of split; InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=25.45 E-value=2.1e+02 Score=29.69 Aligned_cols=77 Identities=10% Similarity=0.130 Sum_probs=41.7
Q ss_pred ccCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEe-cCCC--c-------cCceeEEeeeecCeEE
Q 001655 474 AQLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKE-HLGG--E-------IIPRSVLLCAFEGISY 543 (1036)
Q Consensus 474 ~~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~-~l~~--~-------~~p~si~~~~~~~~~~ 543 (1036)
..++..++.+... +.++++-+- +|.+++|+++..+.+... .+.. + .....|..+.+.+.-.
T Consensus 9 i~Lgs~~~~l~~~--------~~~Ll~iT~-~G~l~vWnl~~~k~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~~G~ 79 (219)
T PF07569_consen 9 IVLGSPVSFLECN--------GSYLLAITS-SGLLYVWNLKKGKAVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTSNGV 79 (219)
T ss_pred EecCCceEEEEeC--------CCEEEEEeC-CCeEEEEECCCCeeccCCccHHHHhcccccccCCCCCcEEEEEEcCCCC
Confidence 3455666666542 456666666 999999999986654321 1110 0 0111222223322233
Q ss_pred EEEEeCCCcEEEEEEe
Q 001655 544 LLCALGDGHLLNFLLN 559 (1036)
Q Consensus 544 L~vgl~~G~l~~y~~~ 559 (1036)
.+|.+.||..+.|..+
T Consensus 80 PiV~lsng~~y~y~~~ 95 (219)
T PF07569_consen 80 PIVTLSNGDSYSYSPD 95 (219)
T ss_pred EEEEEeCCCEEEeccc
Confidence 4566777877777654
No 255
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=25.34 E-value=1.2e+03 Score=27.86 Aligned_cols=234 Identities=12% Similarity=0.092 Sum_probs=124.4
Q ss_pred ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCC
Q 001655 662 HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLP 741 (1036)
Q Consensus 662 tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~ 741 (1036)
-...++|....+.++-++.+. ++++-|-.+++....+. -..+.+.|+... ++..++.+..
T Consensus 251 ~V~~l~~~~~~~~lvsgS~D~----------t~rvWd~~sg~C~~~l~-gh~stv~~~~~~-------~~~~~sgs~D-- 310 (537)
T KOG0274|consen 251 GVWGLAFPSGGDKLVSGSTDK----------TERVWDCSTGECTHSLQ-GHTSSVRCLTID-------PFLLVSGSRD-- 310 (537)
T ss_pred CceeEEEecCCCEEEEEecCC----------cEEeEecCCCcEEEEec-CCCceEEEEEcc-------CceEeeccCC--
Confidence 345566665455555555443 78888988888887766 344666776553 3344442211
Q ss_pred CCCCCcceEEEEEEEeCCeE-EEEEEEEecCceeEeccccCeEEEEEC-CEEEEEEeeecCCCccchhcccccccce-EE
Q 001655 742 EENEPTKGRILVFIVEDGKL-QLIAEKETKGAVYSLNAFNGKLLAAIN-QKIQLYKWMLRDDGTRELQSECGHHGHI-LA 818 (1036)
Q Consensus 742 ~e~~~~~Gri~v~~i~~~kl-~~~~~~~~~g~v~~i~~~~g~Lv~~~g-~~l~v~~~~~~~~~~~~L~~~~~~~~~~-~~ 818 (1036)
--+++|++.+++. .+... +.+||+++..-++.++.+.- .+|.+|+.. ..+.+. .+.++. .+
T Consensus 311 -------~tVkVW~v~n~~~l~l~~~--h~~~V~~v~~~~~~lvsgs~d~~v~VW~~~-----~~~cl~--sl~gH~~~V 374 (537)
T KOG0274|consen 311 -------NTVKVWDVTNGACLNLLRG--HTGPVNCVQLDEPLLVSGSYDGTVKVWDPR-----TGKCLK--SLSGHTGRV 374 (537)
T ss_pred -------ceEEEEeccCcceEEEecc--ccccEEEEEecCCEEEEEecCceEEEEEhh-----hceeee--eecCCcceE
Confidence 2577888886654 33332 89999999987777777655 457776642 112221 122232 23
Q ss_pred EEEEEeC-CEEEEEeccccEEEEEEeccCC-eEEEEeccCCcceeEEEEEeeCceEEEEccCCcEEEEeeCCCCCCcccc
Q 001655 819 LYVQTRG-DFIVVGDLMKSISLLIYKHEEG-AIEERARDYNANWMSAVEILDDDIYLGAENNFNLFTVRKNSEGATDEER 896 (1036)
Q Consensus 819 ~~l~~~~-~~I~vgD~~~Sv~~~~~~~~~~-~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl~~l~~~~~~~~~~~~ 896 (1036)
.++...+ ++++-|-+.+++.+. +.+.. +.... =.....++..-.+.+..++.+-.+|-+.+......
T Consensus 375 ~sl~~~~~~~~~Sgs~D~~IkvW--dl~~~~~c~~t--l~~h~~~v~~l~~~~~~Lvs~~aD~~Ik~WD~~~~------- 443 (537)
T KOG0274|consen 375 YSLIVDSENRLLSGSLDTTIKVW--DLRTKRKCIHT--LQGHTSLVSSLLLRDNFLVSSSADGTIKLWDAEEG------- 443 (537)
T ss_pred EEEEecCcceEEeeeeccceEee--cCCchhhhhhh--hcCCcccccccccccceeEeccccccEEEeecccC-------
Confidence 4455555 788888777777654 44333 11111 11122222222223334455556787777754321
Q ss_pred cceeEEEEEEcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEec-ChhHHHHH
Q 001655 897 GRLEVVGEYHLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASL-PHEQYLFL 957 (1036)
Q Consensus 897 ~~L~~~~~~~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l-~~~~~~~L 957 (1036)
+.+.....=|.+. |+.+. ...+.++.++.+|++... .+ +....+.|
T Consensus 444 ~~~~~~~~~~~~~-v~~l~-------------~~~~~il~s~~~~~~~l~-dl~~~~~~~~l 490 (537)
T KOG0274|consen 444 ECLRTLEGRHVGG-VSALA-------------LGKEEILCSSDDGSVKLW-DLRSGTLIRTL 490 (537)
T ss_pred ceeeeeccCCccc-EEEee-------------cCcceEEEEecCCeeEEE-ecccCchhhhh
Confidence 1121110002111 21211 114688999999999966 44 33334433
No 256
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=25.13 E-value=1.1e+03 Score=28.61 Aligned_cols=65 Identities=17% Similarity=0.226 Sum_probs=37.6
Q ss_pred ccEEEEEEecCCEEEEEECCCC--CeeEE---ecCCCccCceeEEeeee-cCeEEEEEEeCCCcEEEEEEec
Q 001655 495 SQIAAVGMWTDISVRIFSLPDL--NLITK---EHLGGEIIPRSVLLCAF-EGISYLLCALGDGHLLNFLLNM 560 (1036)
Q Consensus 495 ~~~~~vg~w~~~~i~i~~l~~l--~~v~~---~~l~~~~~p~si~~~~~-~~~~~L~vgl~~G~l~~y~~~~ 560 (1036)
+.+++-+.. |.++.+|..++. +.+.. .+++....+.+..-... +....+-+|+..|.++.|+...
T Consensus 630 e~~FaTaSR-DK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv~~~~~~~~e~~~~vavGle~GeI~l~~~~~ 700 (764)
T KOG1063|consen 630 EKYFATASR-DKKVKVWEEPDLRDKYISRFACLKFSLAVTAVAYLPVDHNEKGDVVAVGLEKGEIVLWRRKR 700 (764)
T ss_pred cceeEEecC-CceEEEEeccCchhhhhhhhchhccCCceeeEEeeccccccccceEEEEecccEEEEEeccc
Confidence 444444444 999999999886 32222 11221123333322211 2333567899999999999763
No 257
>PRK12784 hypothetical protein; Provisional
Probab=24.85 E-value=3.3e+02 Score=22.79 Aligned_cols=52 Identities=8% Similarity=0.181 Sum_probs=39.0
Q ss_pred EEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEecCCeEEEEEe
Q 001655 215 RYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYLDNAVVYIGSS 267 (1036)
Q Consensus 215 ~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l~~~~lF~gS~ 267 (1036)
.+++-+.+|.+-.+.+...| .++.+.++.=..+..-..|.++.++++..|++
T Consensus 33 L~~I~~~dg~le~v~vGiSG-~I~~v~Ve~Gq~i~~dtlL~~~edDllitG~~ 84 (84)
T PRK12784 33 LMMIRKNNGELEKVAVGISG-NIRLVNVVVGQQIHTDTLLVRLEDDLLITGCE 84 (84)
T ss_pred eeEEeecCCcEEEEEEeeee-eEEEEEeecCceecCCcEEEEEeeceEeecCC
Confidence 36777889999999887665 46666666544565667899999999988863
No 258
>COG5161 SFT1 Pre-mRNA cleavage and polyadenylation specificity factor [RNA processing and modification]
Probab=24.62 E-value=19 Score=43.44 Aligned_cols=80 Identities=19% Similarity=0.194 Sum_probs=58.1
Q ss_pred eEEEeEEEeEeeeeccCCCCccEEEEEeCcCcEEEEEEeCCCCcEEEEEeeeccCCCCc-c--CCCCCeEEECCCCCEEE
Q 001655 3 DVPIYGRIATLELFRPHGEAQDFLFIATERYKFCVLQWDAESSELITRAMGDVSDRIGR-P--TDNGQIGIIDPDCRLIG 79 (1036)
Q Consensus 3 ~~~l~g~i~~i~~~r~~~~~~D~Llv~~~~~~l~il~~~~~~~~~~t~s~~~~~~~~~~-~--~~~~~~l~vdp~~r~~~ 79 (1036)
+.+.|++|. +..++.+.++ ..+++-+|++.++||+++ +-++|+.+|-+.. | ........|+|+.-|.+
T Consensus 94 q~n~f~Tis-lhyyeGKfkg----ksLvelak~stle~D~~s----scaLlfneDi~~flpfhvnkndddev~~d~D~~~ 164 (1319)
T COG5161 94 QANEFRTIS-LHYYEGKFKG----KSLVELAKFSTLEFDIRS----SCALLFNEDIGNFLPFHVNKNDDDEVRIDVDLGM 164 (1319)
T ss_pred hcccceeEE-EeeeccccCC----chhhhhhhhhheeeccCc----cchhhhhhhhhhcccccccCCccccccccccccH
Confidence 345678877 7777666555 445778999999999986 4567888876543 2 22234678899988888
Q ss_pred EEecCCeEEEEe
Q 001655 80 LHLYDGLFKVIP 91 (1036)
Q Consensus 80 ~~~~~~~~~ilp 91 (1036)
......++.++|
T Consensus 165 ~~~~~~h~~i~p 176 (1319)
T COG5161 165 FQMSKRHFSIFP 176 (1319)
T ss_pred HHHHHHHhhcCC
Confidence 777778888888
No 259
>PF05096 Glu_cyclase_2: Glutamine cyclotransferase; InterPro: IPR007788 This family of enzymes 2.3.2.5 from EC catalyse the cyclization of free L-glutamine and N-terminal glutaminyl residues in proteins to pyroglutamate (5-oxoproline) and pyroglutamyl residues respectively []. This family includes plant and bacterial enzymes and seems unrelated to the mammalian enzymes.; PDB: 3NOK_B 2FAW_A 2IWA_A 3NOM_A 3NOL_A 3MBR_X.
Probab=24.05 E-value=9e+02 Score=25.85 Aligned_cols=89 Identities=17% Similarity=0.143 Sum_probs=57.8
Q ss_pred eeEEEEEEeCCCceEEEEEECCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEe
Q 001655 690 EMHFVRLLDDQTFEFISTYPLDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKET 769 (1036)
Q Consensus 690 ~~~~l~l~d~~t~~~i~~~~~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~ 769 (1036)
.+|+|+-+|+.|++++.+.+|++.-....+..+ ...|..=| -.+|..++|+.. .++.+.....
T Consensus 66 G~S~l~~~d~~tg~~~~~~~l~~~~FgEGit~~------~d~l~qLT---------Wk~~~~f~yd~~--tl~~~~~~~y 128 (264)
T PF05096_consen 66 GQSSLRKVDLETGKVLQSVPLPPRYFGEGITIL------GDKLYQLT---------WKEGTGFVYDPN--TLKKIGTFPY 128 (264)
T ss_dssp TEEEEEEEETTTSSEEEEEE-TTT--EEEEEEE------TTEEEEEE---------SSSSEEEEEETT--TTEEEEEEE-
T ss_pred CcEEEEEEECCCCcEEEEEECCccccceeEEEE------CCEEEEEE---------ecCCeEEEEccc--cceEEEEEec
Confidence 368999999999999999999988777777655 22344334 255677777643 4677777777
Q ss_pred cCceeEeccccCeEEEEEC-CEEEEEE
Q 001655 770 KGAVYSLNAFNGKLLAAIN-QKIQLYK 795 (1036)
Q Consensus 770 ~g~v~~i~~~~g~Lv~~~g-~~l~v~~ 795 (1036)
+|-=-.+|.-+..|+++-| ++|+.++
T Consensus 129 ~~EGWGLt~dg~~Li~SDGS~~L~~~d 155 (264)
T PF05096_consen 129 PGEGWGLTSDGKRLIMSDGSSRLYFLD 155 (264)
T ss_dssp SSS--EEEECSSCEEEE-SSSEEEEE-
T ss_pred CCcceEEEcCCCEEEEECCccceEEEC
Confidence 7766667766778999998 5666544
No 260
>PF13545 HTH_Crp_2: Crp-like helix-turn-helix domain; PDB: 3LA2_A 3LA3_B 3LA7_A 3B02_A 3E97_A 2H6C_B 1OMI_A 2BGC_H 2BEO_A 2GAU_A ....
Probab=23.84 E-value=82 Score=26.01 Aligned_cols=25 Identities=24% Similarity=0.399 Sum_probs=22.3
Q ss_pred HHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1010 RMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1010 ~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
.|++||+-+|++++.+.+.|.+|++
T Consensus 30 t~~~iA~~~g~sr~tv~r~l~~l~~ 54 (76)
T PF13545_consen 30 TQEEIADMLGVSRETVSRILKRLKD 54 (76)
T ss_dssp SHHHHHHHHTSCHHHHHHHHHHHHH
T ss_pred CHHHHHHHHCCCHHHHHHHHHHHHH
Confidence 3689999999999999999999875
No 261
>PF06971 Put_DNA-bind_N: Putative DNA-binding protein N-terminus; InterPro: IPR009718 This entry represents the C terminus (approximately 30 residues) of a number of Rex proteins. These are redox-sensing repressors that appear to be widespread among Gram-positive bacteria []. They modulate transcription in response to changes in cellular NADH/NAD(+) redox state. Rex is predicted to include a pyridine nucleotide-binding domain (Rossmann fold), and residues that might play key structural and nucleotide binding roles are highly conserved.; GO: 0045892 negative regulation of transcription, DNA-dependent, 0051775 response to redox state, 0005737 cytoplasm; PDB: 3IL2_B 3IKT_A 3IKV_B 1XCB_F 2DT5_A 2VT3_A 2VT2_A 3KEO_B 3KET_A 3KEQ_A ....
Probab=23.24 E-value=78 Score=24.15 Aligned_cols=19 Identities=11% Similarity=0.394 Sum_probs=15.9
Q ss_pred HHHHHhcCCCHHHHHHHHH
Q 001655 1012 DEISKTMNVSVEELCKRVE 1030 (1036)
Q Consensus 1012 ~~i~~~~~~~~~~i~~~l~ 1030 (1036)
.++|+.+|+++.+|.|++.
T Consensus 32 ~~La~~~gi~~~qVRKDlS 50 (50)
T PF06971_consen 32 QELAEALGITPAQVRKDLS 50 (50)
T ss_dssp HHHHHHHTS-HHHHHHHHH
T ss_pred HHHHHHHCCCHHHhcccCC
Confidence 6789999999999999974
No 262
>PF14870 PSII_BNR: Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=23.20 E-value=1e+03 Score=26.11 Aligned_cols=200 Identities=14% Similarity=0.209 Sum_probs=88.5
Q ss_pred CCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeC-CCceEEEEEECCCCCeEeEEEEEEEcCCC
Q 001655 650 QKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDD-QTFEFISTYPLDTFEYGCSILSCSFSDDS 728 (1036)
Q Consensus 650 ~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~-~t~~~i~~~~~~~~E~v~si~~~~l~~~~ 728 (1036)
..|...++|...+...|.+..+.+-++|..... -++=-|. ++|+.... ..+ ++.-..+..+.+..
T Consensus 6 ~~W~~v~l~t~~~l~dV~F~d~~~G~~VG~~g~----------il~T~DGG~tW~~~~~-~~~-~~~~~~l~~I~f~~-- 71 (302)
T PF14870_consen 6 NSWQQVSLPTDKPLLDVAFVDPNHGWAVGAYGT----------ILKTTDGGKTWQPVSL-DLD-NPFDYHLNSISFDG-- 71 (302)
T ss_dssp --EEEEE-S-SS-EEEEEESSSS-EEEEETTTE----------EEEESSTTSS-EE------S------EEEEEEEET--
T ss_pred CCcEEeecCCCCceEEEEEecCCEEEEEecCCE----------EEEECCCCcccccccc-CCC-ccceeeEEEEEecC--
Confidence 468888888889999999998888888875321 1111122 56765542 111 11112334445543
Q ss_pred ceEEEEEeeeeCCCCCCCcceEEEEEEEeC--CeEEEEE-EEEecCceeEeccccC-eEEE-EECCEEEEEEeeecCCCc
Q 001655 729 NVYYCVGTAYVLPEENEPTKGRILVFIVED--GKLQLIA-EKETKGAVYSLNAFNG-KLLA-AINQKIQLYKWMLRDDGT 803 (1036)
Q Consensus 729 ~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~--~kl~~~~-~~~~~g~v~~i~~~~g-~Lv~-~~g~~l~v~~~~~~~~~~ 803 (1036)
.+-++||.. | +++.-.+ ...+.+. ....+|..+.+..+++ ..++ +....| |. - +++.
T Consensus 72 ~~g~ivG~~-----------g--~ll~T~DgG~tW~~v~l~~~lpgs~~~i~~l~~~~~~l~~~~G~i--y~--T-~DgG 133 (302)
T PF14870_consen 72 NEGWIVGEP-----------G--LLLHTTDGGKTWERVPLSSKLPGSPFGITALGDGSAELAGDRGAI--YR--T-TDGG 133 (302)
T ss_dssp TEEEEEEET-----------T--EEEEESSTTSS-EE----TT-SS-EEEEEEEETTEEEEEETT--E--EE--E-SSTT
T ss_pred CceEEEcCC-----------c--eEEEecCCCCCcEEeecCCCCCCCeeEEEEcCCCcEEEEcCCCcE--EE--e-CCCC
Confidence 456677741 2 2344432 2455554 3356787777777754 3333 322333 33 1 2344
Q ss_pred cchhcccccccceEEEEEE--EeCCEEEEEeccccEEEEEEeccCCeEEEEeccCCcceeEEEEEeeCceEEEEccCCcE
Q 001655 804 RELQSECGHHGHILALYVQ--TRGDFIVVGDLMKSISLLIYKHEEGAIEERARDYNANWMSAVEILDDDIYLGAENNFNL 881 (1036)
Q Consensus 804 ~~L~~~~~~~~~~~~~~l~--~~~~~I~vgD~~~Sv~~~~~~~~~~~l~~~a~D~~~~~~~~~~~l~~~~~l~~D~~gnl 881 (1036)
+.+..... ........+. ..+.+++|+ .++-.+..+++......+..|. .++.+.++.|-.++.+....+-|.+
T Consensus 134 ~tW~~~~~-~~~gs~~~~~r~~dG~~vavs--~~G~~~~s~~~G~~~w~~~~r~-~~~riq~~gf~~~~~lw~~~~Gg~~ 209 (302)
T PF14870_consen 134 KTWQAVVS-ETSGSINDITRSSDGRYVAVS--SRGNFYSSWDPGQTTWQPHNRN-SSRRIQSMGFSPDGNLWMLARGGQI 209 (302)
T ss_dssp SSEEEEE--S----EEEEEE-TTS-EEEEE--TTSSEEEEE-TT-SS-EEEE---SSS-EEEEEE-TTS-EEEEETTTEE
T ss_pred CCeeEccc-CCcceeEeEEECCCCcEEEEE--CcccEEEEecCCCccceEEccC-ccceehhceecCCCCEEEEeCCcEE
Confidence 44432211 1111122222 234555565 5555556666655567777776 4466788888777666555577776
Q ss_pred EEEe
Q 001655 882 FTVR 885 (1036)
Q Consensus 882 ~~l~ 885 (1036)
+.-+
T Consensus 210 ~~s~ 213 (302)
T PF14870_consen 210 QFSD 213 (302)
T ss_dssp EEEE
T ss_pred EEcc
Confidence 6655
No 263
>smart00550 Zalpha Z-DNA-binding domain in adenosine deaminases. Helix-turn-helix-containing domain. Also known as Zab.
Probab=23.03 E-value=1.1e+02 Score=25.06 Aligned_cols=38 Identities=11% Similarity=0.223 Sum_probs=29.6
Q ss_pred hHHHHHhcCCH--HHHHHHHHhcCCCHHHHHHHHHHHhcc
Q 001655 998 DLIESFLDLSR--TRMDEISKTMNVSVEELCKRVEELTRL 1035 (1036)
Q Consensus 998 dll~~fl~l~~--~~q~~i~~~~~~~~~~i~~~l~~l~~~ 1035 (1036)
.+|+.+..-+. -.+.+||+.+|++...+.+.|..|++.
T Consensus 10 ~IL~~L~~~g~~~~ta~eLa~~lgl~~~~v~r~L~~L~~~ 49 (68)
T smart00550 10 KILEFLENSGDETSTALQLAKNLGLPKKEVNRVLYSLEKK 49 (68)
T ss_pred HHHHHHHHCCCCCcCHHHHHHHHCCCHHHHHHHHHHHHHC
Confidence 34555555545 678999999999999999999888763
No 264
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=22.65 E-value=5.3e+02 Score=27.04 Aligned_cols=114 Identities=11% Similarity=0.066 Sum_probs=70.0
Q ss_pred EEEeCCEEEEEeccccEEEEEEeccC--CeEEEEeccCCcceeEEEEEeeCceEEE-EccCCcEEEEeeCCCCCCccccc
Q 001655 821 VQTRGDFIVVGDLMKSISLLIYKHEE--GAIEERARDYNANWMSAVEILDDDIYLG-AENNFNLFTVRKNSEGATDEERG 897 (1036)
Q Consensus 821 l~~~~~~I~vgD~~~Sv~~~~~~~~~--~~l~~~a~D~~~~~~~~~~~l~~~~~l~-~D~~gnl~~l~~~~~~~~~~~~~ 897 (1036)
++..|.+|...-.-+.|-++...... +.+.++--+..|.|-.+-..--.+++|+ +-.+|.+.+.+... .
T Consensus 19 lDyygkrlATcsSD~tVkIf~v~~n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iLAScsYDgkVIiWke~~--------g 90 (299)
T KOG1332|consen 19 LDYYGKRLATCSSDGTVKIFEVRNNGQSKLLAELTGHSGPVWKVAWAHPKFGTILASCSYDGKVIIWKEEN--------G 90 (299)
T ss_pred hhhhcceeeeecCCccEEEEEEcCCCCceeeeEecCCCCCeeEEeecccccCcEeeEeecCceEEEEecCC--------C
Confidence 45567788877777888887766543 3456666788888765543333466765 45588888887543 1
Q ss_pred ceeEEEEE-EcCCccceEEeeeeeecCCCCCCCCcceEEEEccccceEEEEecCh
Q 001655 898 RLEVVGEY-HLGEFVNRFRHGSLVMRLPDSDVGQIPTVIFGTVNGVIGVIASLPH 951 (1036)
Q Consensus 898 ~L~~~~~~-~lg~~v~~~~~~~l~~~~~~~~~~~~~~il~~t~~GsIg~l~~l~~ 951 (1036)
+-....++ .+...||++.- . +......+.+++.||.|..+.-=++
T Consensus 91 ~w~k~~e~~~h~~SVNsV~w---a------pheygl~LacasSDG~vsvl~~~~~ 136 (299)
T KOG1332|consen 91 RWTKAYEHAAHSASVNSVAW---A------PHEYGLLLACASSDGKVSVLTYDSS 136 (299)
T ss_pred chhhhhhhhhhcccceeecc---c------ccccceEEEEeeCCCcEEEEEEcCC
Confidence 33322322 12345666532 1 1234567889999999997765444
No 265
>PF08220 HTH_DeoR: DeoR-like helix-turn-helix domain; InterPro: IPR001034 The deoR-type HTH domain is a DNA-binding, helix-turn-helix (HTH) domain of about 50-60 amino acids present in transcription regulators of the deoR family, involved in sugar catabolism. This family of prokaryotic regulators is named after the Escherichia coli protein DeoR, a repressor of the deo operon, which encodes nucleotide and deoxyribonucleotide catabolic enzymes. DeoR also negatively regulates the expression of nupG and tsx, a nucleoside-specific transport protein and a channel-forming protein, respectively. DeoR-like transcription repressors occur in diverse bacteria as regulators of sugar and nucleoside metabolic systems. The effector molecules for deoR-like regulators are generally phosphorylated intermediates of the relevant metabolic pathway. The DNA-binding deoR-type HTH domain occurs usually in the N-terminal part. The C-terminal part can contain an effector-binding domain and/or an oligomerisation domain. DeoR occurs as an octamer, whilst glpR and agaR are tetramers. Several operators may be bound simultaneously, which could facilitate DNA looping [, ].; GO: 0003700 sequence-specific DNA binding transcription factor activity, 0006355 regulation of transcription, DNA-dependent, 0005622 intracellular
Probab=22.41 E-value=81 Score=24.66 Aligned_cols=29 Identities=14% Similarity=0.330 Sum_probs=23.7
Q ss_pred CCHHHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1006 LSRTRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1006 l~~~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
-+.-.-.++|+.+|+|...|.++|.+|..
T Consensus 12 ~~~~s~~ela~~~~VS~~TiRRDl~~L~~ 40 (57)
T PF08220_consen 12 KGKVSVKELAEEFGVSEMTIRRDLNKLEK 40 (57)
T ss_pred cCCEEHHHHHHHHCcCHHHHHHHHHHHHH
Confidence 34445578999999999999999999864
No 266
>PF05920 Homeobox_KN: Homeobox KN domain; InterPro: IPR008422 This entry represents a homeobox transcription factor KN domain conserved from fungi to human and plants [].; GO: 0003677 DNA binding, 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus; PDB: 3K2A_B 2LK2_A 1X2N_A 2DMN_A.
Probab=22.11 E-value=1.4e+02 Score=21.50 Aligned_cols=28 Identities=18% Similarity=0.306 Sum_probs=22.2
Q ss_pred CHHHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1007 SRTRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1007 ~~~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
+.+++.++|+..|.+..+|..-+.+-+|
T Consensus 12 s~~ek~~L~~~tgls~~Qi~~WF~NaRr 39 (40)
T PF05920_consen 12 SKEEKEELAKQTGLSRKQISNWFINARR 39 (40)
T ss_dssp -HHHHHHHHHHHTS-HHHHHHHHHHHHH
T ss_pred CHHHHHHHHHHcCCCHHHHHHHHHHhHc
Confidence 5788889999999999999988776654
No 267
>PF12341 DUF3639: Protein of unknown function (DUF3639) ; InterPro: IPR022100 This domain family is found in eukaryotes, and is approximately 30 amino acids in length. The family is found in association with PF00400 from PFAM. There are two completely conserved residues (E and R) that may be functionally important.
Probab=22.09 E-value=2.4e+02 Score=18.49 Aligned_cols=24 Identities=33% Similarity=0.365 Sum_probs=17.7
Q ss_pred CCcEEEEEeCCCEEEEEEcCCeEE
Q 001655 436 GYSVNVATANASQVLLATGGGHLV 459 (1036)
Q Consensus 436 ~~~I~~as~~~~~vvv~~~~~~~~ 459 (1036)
|+.|.+.+..+.++.++.+.+-+.
T Consensus 1 gE~i~aia~g~~~vavaTS~~~lR 24 (27)
T PF12341_consen 1 GEEIEAIAAGDSWVAVATSAGYLR 24 (27)
T ss_pred CceEEEEEccCCEEEEEeCCCeEE
Confidence 346888888888988888765543
No 268
>PF08280 HTH_Mga: M protein trans-acting positive regulator (MGA) HTH domain; InterPro: IPR013199 Mga is a DNA-binding protein that activates the expression of several important virulence genes in group A streptococcus in response to changing environmental conditions [].; PDB: 2WTE_A 3SQN_A.
Probab=21.98 E-value=66 Score=25.39 Aligned_cols=36 Identities=25% Similarity=0.435 Sum_probs=25.2
Q ss_pred HHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 999 LIESFLDLSRTRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 999 ll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
+|+.+++=+.-.-.++|+.+|++...|.++|++|+.
T Consensus 10 Ll~~L~~~~~~~~~ela~~l~~S~rti~~~i~~L~~ 45 (59)
T PF08280_consen 10 LLELLLKNKWITLKELAKKLNISERTIKNDINELNE 45 (59)
T ss_dssp HHHHHHHHTSBBHHHHHHHCTS-HHHHHHHHHHHHT
T ss_pred HHHHHHcCCCCcHHHHHHHHCCCHHHHHHHHHHHHH
Confidence 344444322233468999999999999999999974
No 269
>smart00419 HTH_CRP helix_turn_helix, cAMP Regulatory protein.
Probab=21.83 E-value=1.1e+02 Score=22.33 Aligned_cols=26 Identities=15% Similarity=0.369 Sum_probs=22.4
Q ss_pred HHHHHHHHhcCCCHHHHHHHHHHHhc
Q 001655 1009 TRMDEISKTMNVSVEELCKRVEELTR 1034 (1036)
Q Consensus 1009 ~~q~~i~~~~~~~~~~i~~~l~~l~~ 1034 (1036)
-.+.++|+.+|+++..+.+.|..|.+
T Consensus 9 ~s~~~la~~l~~s~~tv~~~l~~L~~ 34 (48)
T smart00419 9 LTRQEIAELLGLTRETVSRTLKRLEK 34 (48)
T ss_pred cCHHHHHHHHCCCHHHHHHHHHHHHH
Confidence 45789999999999999999988875
No 270
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=21.24 E-value=1.1e+03 Score=25.61 Aligned_cols=271 Identities=14% Similarity=0.115 Sum_probs=128.3
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeeecCeEEEEEEeCCCcEEEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAFEGISYLLCALGDGHLLNFL 557 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~~~~~~L~vgl~~G~l~~y~ 557 (1036)
..|.|++..+ .+..++-+.- ||.+.||+.-+-..+...+++...+ -..++. .+..++-+|--|....+|.
T Consensus 56 ~Ki~~~~ws~------Dsr~ivSaSq-DGklIvWDs~TtnK~haipl~s~WV-MtCA~s--PSg~~VAcGGLdN~Csiy~ 125 (343)
T KOG0286|consen 56 NKIYAMDWST------DSRRIVSASQ-DGKLIVWDSFTTNKVHAIPLPSSWV-MTCAYS--PSGNFVACGGLDNKCSIYP 125 (343)
T ss_pred cceeeeEecC------CcCeEEeecc-CCeEEEEEcccccceeEEecCceeE-EEEEEC--CCCCeEEecCcCceeEEEe
Confidence 4677888754 2445544444 8888888854322233233332110 011111 2456677777788888898
Q ss_pred EecCCCccccceeeecCccceEEEEEEeCCceEEEEE-cCCceEEEec--CCcE--EEeeeccccceeeecccCCCCCCe
Q 001655 558 LNMKTGELTDRKKVSLGTQPITLRTFSSKNTTHVFAA-SDRPTVIYSS--NKKL--LYSNVNLKEVSHMCPFNSAAFPDS 632 (1036)
Q Consensus 558 ~~~~~~~l~~~~~~~lG~~pv~l~~~~~~~~~~v~~~-~~~p~~i~~~--~~~~--~~~~~~~~~i~~~~~f~~~~~~~~ 632 (1036)
+.....+-.-+..+.+...---|..++.-+.+.++.. ||... ..++ .+.. .|.. +..++.++.-- +.-++.
T Consensus 126 ls~~d~~g~~~v~r~l~gHtgylScC~f~dD~~ilT~SGD~TC-alWDie~g~~~~~f~G-H~gDV~slsl~--p~~~nt 201 (343)
T KOG0286|consen 126 LSTRDAEGNVRVSRELAGHTGYLSCCRFLDDNHILTGSGDMTC-ALWDIETGQQTQVFHG-HTGDVMSLSLS--PSDGNT 201 (343)
T ss_pred cccccccccceeeeeecCccceeEEEEEcCCCceEecCCCceE-EEEEcccceEEEEecC-CcccEEEEecC--CCCCCe
Confidence 7643211111112222221112333332223344443 34333 3333 2221 1221 12333332211 112222
Q ss_pred EEEEeCCeEEEEEEcCCC-CeEEEEEeCCC-ccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEEC
Q 001655 633 LAIAKEGELTIGTIDDIQ-KLHIRSIPLGE-HPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPL 710 (1036)
Q Consensus 633 l~~~~~~~l~i~~l~~~~-~~~~~~i~l~~-tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~ 710 (1036)
| ++++.=.-+.+.+.. ...+++++-.+ ..+.|.|+|....|+-++.+ ...|++|-...+.+..|+
T Consensus 202 F--vSg~cD~~aklWD~R~~~c~qtF~ghesDINsv~ffP~G~afatGSDD----------~tcRlyDlRaD~~~a~ys- 268 (343)
T KOG0286|consen 202 F--VSGGCDKSAKLWDVRSGQCVQTFEGHESDINSVRFFPSGDAFATGSDD----------ATCRLYDLRADQELAVYS- 268 (343)
T ss_pred E--EecccccceeeeeccCcceeEeecccccccceEEEccCCCeeeecCCC----------ceeEEEeecCCcEEeeec-
Confidence 3 233222333444333 45667777655 67889999998877766543 478899987777776665
Q ss_pred CCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCe-EEEEEEEEecCceeEeccccCeEEEEECC
Q 001655 711 DTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGK-LQLIAEKETKGAVYSLNAFNGKLLAAINQ 789 (1036)
Q Consensus 711 ~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~k-l~~~~~~~~~g~v~~i~~~~g~Lv~~~g~ 789 (1036)
+.-.+.-+.++-|... ..++..|- ......+|+.-+++ .-.+. -+++.|+++..-.+...+|.|.
T Consensus 269 -~~~~~~gitSv~FS~S-GRlLfagy----------~d~~c~vWDtlk~e~vg~L~--GHeNRvScl~~s~DG~av~TgS 334 (343)
T KOG0286|consen 269 -HDSIICGITSVAFSKS-GRLLFAGY----------DDFTCNVWDTLKGERVGVLA--GHENRVSCLGVSPDGMAVATGS 334 (343)
T ss_pred -cCcccCCceeEEEccc-ccEEEeee----------cCCceeEeeccccceEEEee--ccCCeeEEEEECCCCcEEEecc
Confidence 2222233444445432 23444441 11234455443322 11222 4567777777666666666663
No 271
>PF09826 Beta_propel: Beta propeller domain; InterPro: IPR019198 This entry consists of predicted secreted proteins containing a C-terminal beta-propeller domain distantly related to WD-40 repeats.
Probab=21.14 E-value=1.4e+03 Score=27.15 Aligned_cols=107 Identities=17% Similarity=0.219 Sum_probs=73.6
Q ss_pred ecCCCEEEEEEeecC--CCCCceeeEEEEEEeCCCceEEEEEE-CCCCCeEeEEEEEEEcCCCceEEEEEeeeeCCCCCC
Q 001655 669 QEQSRTFAICSLKNQ--SCAEESEMHFVRLLDDQTFEFISTYP-LDTFEYGCSILSCSFSDDSNVYYCVGTAYVLPEENE 745 (1036)
Q Consensus 669 ~~~~~~~~v~~~~~~--~~~~~~~~~~l~l~d~~t~~~i~~~~-~~~~E~v~si~~~~l~~~~~~~i~VGT~~~~~~e~~ 745 (1036)
++..+.+-|++.... ..++......|-++| .+++.+.+++ +.++|++.|+..+ +...++|-=-...|
T Consensus 279 dE~~G~LRvaTT~~~~~~~~~~~s~N~lyVLD-~~L~~vG~l~~la~gE~IysvRF~-----Gd~~Y~VTFrqvDP---- 348 (521)
T PF09826_consen 279 DEYDGYLRVATTSGNWWWDSEDTSSNNLYVLD-EDLKIVGSLEGLAPGERIYSVRFM-----GDRAYLVTFRQVDP---- 348 (521)
T ss_pred eccCCEEEEEEecCcccccCCCCceEEEEEEC-CCCcEeEEccccCCCceEEEEEEe-----CCeEEEEEEeecCc----
Confidence 445556666665432 234445677888898 6899998875 9999999887654 23344443332332
Q ss_pred CcceEEEEEEEeC-CeEEEEEEEEecCceeEeccccCeEEEEECCE
Q 001655 746 PTKGRILVFIVED-GKLQLIAEKETKGAVYSLNAFNGKLLAAINQK 790 (1036)
Q Consensus 746 ~~~Gri~v~~i~~-~kl~~~~~~~~~g~v~~i~~~~g~Lv~~~g~~ 790 (1036)
++++++.+ .+-+++.+.+++|==.-+.++++..++++|..
T Consensus 349 -----LfviDLsdP~~P~vlGeLKIPGfS~YLHP~~e~~LlGiG~~ 389 (521)
T PF09826_consen 349 -----LFVIDLSDPANPKVLGELKIPGFSDYLHPYDENHLLGIGKD 389 (521)
T ss_pred -----eEEEECCCCCCCceeeEEECccchhceeECCCCeEEEEccc
Confidence 56666665 36888999999998888889988888888853
No 272
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=21.12 E-value=3.2e+02 Score=30.65 Aligned_cols=72 Identities=15% Similarity=0.117 Sum_probs=44.0
Q ss_pred EEEEEeC--CCEEEEEEcCCeEEEEEEcCcEEEEEEec-cCCceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCC
Q 001655 439 VNVATAN--ASQVLLATGGGHLVYLEIGDGILTEVKHA-QLEYEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPD 515 (1036)
Q Consensus 439 I~~as~~--~~~vvv~~~~~~~~~l~~~~~~l~~~~~~-~l~~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~ 515 (1036)
|..+..+ +++++-+..+..+..|++. .+.++... .-..++.++.-.|+. ...+..|.| ||++..|.++-
T Consensus 267 Vl~~~f~~n~N~Llt~skD~~~kv~DiR--~mkEl~~~r~Hkkdv~~~~WhP~~-----~~lftsgg~-Dgsvvh~~v~~ 338 (464)
T KOG0284|consen 267 VLAVKFNPNGNWLLTGSKDQSCKVFDIR--TMKELFTYRGHKKDVTSLTWHPLN-----ESLFTSGGS-DGSVVHWVVGL 338 (464)
T ss_pred EEEEEEcCCCCeeEEccCCceEEEEehh--HhHHHHHhhcchhhheeecccccc-----ccceeeccC-CCceEEEeccc
Confidence 4444444 4455555556666666653 22232221 234678888776654 567888889 99999999874
Q ss_pred CCe
Q 001655 516 LNL 518 (1036)
Q Consensus 516 l~~ 518 (1036)
.++
T Consensus 339 ~~p 341 (464)
T KOG0284|consen 339 EEP 341 (464)
T ss_pred ccc
Confidence 333
No 273
>PF02023 SCAN: SCAN domain; InterPro: IPR003309 A number of C2H2-zinc finger proteins contain a highly conserved N-terminal motif termed the SCAN domain. The SCAN domain may play an important role in the assembly and function of this newly defined subclass of transcriptional regulators [].; GO: 0003700 sequence-specific DNA binding transcription factor activity, 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus; PDB: 3LHR_B 4E6S_A 2FI2_A 1Y7Q_A.
Probab=21.04 E-value=1.6e+02 Score=25.89 Aligned_cols=45 Identities=22% Similarity=0.259 Sum_probs=37.5
Q ss_pred CcEEehhHHHHHhc-CCHHHHHHHHHhcCCCHHHHHHHHHHHhccC
Q 001655 992 KNFLDGDLIESFLD-LSRTRMDEISKTMNVSVEELCKRVEELTRLH 1036 (1036)
Q Consensus 992 ~~~iDGdll~~fl~-l~~~~q~~i~~~~~~~~~~i~~~l~~l~~~h 1036 (1036)
..++|-=++|+|+. ||.+.|..|-++---+.+++..+++++.+.|
T Consensus 43 eqi~ellvlEQFL~~lP~e~~~wV~e~~p~s~~ea~~Lae~~~~~~ 88 (95)
T PF02023_consen 43 EQILELLVLEQFLNILPPEVQTWVRERKPESAEEAVALAEDYQRAR 88 (95)
T ss_dssp HHHHHHHHHHHHHHHS-HHHHHHHHTCS-SSHHHHHHHHHHHHCCC
T ss_pred HHHHHHHHHHHHHHHCCHHHHHHHHhcCCCCHHHHHHHHHHHHHhh
Confidence 36889999999997 9999999999887778999999999988754
No 274
>PF11972 HTH_13: HTH DNA binding domain; InterPro: IPR021068 The proteins in this entry have not been characterised. They contain a C-terminal helix-turn-helix DNA binding domain.
Probab=20.89 E-value=1.6e+02 Score=22.86 Aligned_cols=35 Identities=20% Similarity=0.288 Sum_probs=27.1
Q ss_pred hHHHHHhcCCHHHHHHHHHhcCCCHHHHHHHHHHH
Q 001655 998 DLIESFLDLSRTRMDEISKTMNVSVEELCKRVEEL 1032 (1036)
Q Consensus 998 dll~~fl~l~~~~q~~i~~~~~~~~~~i~~~l~~l 1032 (1036)
++++.++.-|--.-..+++++|+|+.-..+++++|
T Consensus 3 ~Lidll~~~P~Vsa~mva~~L~vT~~~A~~li~eL 37 (54)
T PF11972_consen 3 RLIDLLLSRPLVSAPMVAKELGVTPQAAQRLIAEL 37 (54)
T ss_pred HHHHHHHhCccccHHHHHHHhCCCHHHHHHHHHHh
Confidence 46666667777777788888899888888888776
No 275
>KOG1898 consensus Splicing factor 3b, subunit 3 [RNA processing and modification]
Probab=20.78 E-value=1.9e+03 Score=28.36 Aligned_cols=102 Identities=13% Similarity=0.142 Sum_probs=59.5
Q ss_pred CCCEEEEEcCccCEEEEEEEecCcEEeeEEEEEcCccccceEEEEe-------cCCeEEEEEeecCeeEEEEeeCCCCCC
Q 001655 212 DGSRYLLGDHAGLLHLLVITHEKEKVTGLKIELLGETSIASTISYL-------DNAVVYIGSSYGDSQLIKLNLQPDAKG 284 (1036)
Q Consensus 212 ~~~~~ll~~~~G~l~~l~l~~~~~~v~~l~i~~~~~~~~~s~l~~l-------~~~~lF~gS~~gds~l~~~~~~~~~~~ 284 (1036)
...+++++..+|.|+++.....| ....+. ++.--...++|++.- .+.++-+|+-.+.-..+-+.+.+
T Consensus 548 nr~qiVvalSngelvyfe~d~sg-ql~E~~-er~tl~~~vac~ai~~~~~g~krsrfla~a~~d~~vriisL~p~d---- 621 (1205)
T KOG1898|consen 548 NRRQIVVALSNGELVYFEGDVSG-QLNEFT-ERVTLSTDVACLAIGQDPEGEKRSRFLALASVDNMVRIISLDPSD---- 621 (1205)
T ss_pred cceEEEEEccCCeEEEEEeccCc-cceeee-eeeeeceeehhhccCCCCcchhhcceeeeeccccceeEEEecCcc----
Confidence 34689999999999999887443 222222 121112334454432 24567778777777777776532
Q ss_pred CcEEEeeecccCCceeeeEEeccCCC---CCceEEEEee
Q 001655 285 SYVEVLERYVNLGPIVDFCVVDLERQ---GQGQVVTCSG 320 (1036)
Q Consensus 285 ~~~~~~~~l~n~~Pi~D~~~~~~~~~---~~~~lv~~sG 320 (1036)
.+..+..-.=-.|+.++++++..+. ...+|+.-+|
T Consensus 622 -~l~~ls~q~l~~~~~s~~iv~~~~~~~~~~~~L~l~~G 659 (1205)
T KOG1898|consen 622 -CLQPLSVQGLSSPPESLCIVEMEATGGTDVAQLYLLIG 659 (1205)
T ss_pred -eEEEccccccCCCccceEEEEecccCCccceeEEEEec
Confidence 1333322222247788888876532 2357887777
No 276
>PF08309 LVIVD: LVIVD repeat; InterPro: IPR013211 This repeat is found in bacterial and archaeal cell surface proteins, many of which are hypothetical. The secondary structure corresponding to this repeat is predicted to comprise 4 beta-strands, which may associate to form a beta-propeller. The repeat copy number varies from 2-14. This repeat is sometimes found with the PKD domain IPR000601 from INTERPRO.
Probab=20.77 E-value=2.4e+02 Score=20.60 Aligned_cols=25 Identities=20% Similarity=0.235 Sum_probs=21.1
Q ss_pred EEEEEEeCCEEEEEeccccEEEEEE
Q 001655 818 ALYVQTRGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 818 ~~~l~~~~~~I~vgD~~~Sv~~~~~ 842 (1036)
+..+.+.||+.+++|-..++.++-.
T Consensus 4 a~~v~v~g~yaYva~~~~Gl~IvDI 28 (42)
T PF08309_consen 4 ARDVAVSGNYAYVADGNNGLVIVDI 28 (42)
T ss_pred EEEEEEECCEEEEEeCCCCEEEEEC
Confidence 5667889999999999999987643
No 277
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=20.74 E-value=4.7e+02 Score=29.98 Aligned_cols=173 Identities=16% Similarity=0.190 Sum_probs=96.1
Q ss_pred EeCCeEEEEEEcCCCCeEEEEEeCCCccceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEEEECCCCCe
Q 001655 636 AKEGELTIGTIDDIQKLHIRSIPLGEHPRRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFISTYPLDTFEY 715 (1036)
Q Consensus 636 ~~~~~l~i~~l~~~~~~~~~~i~l~~tp~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~~~~~~~E~ 715 (1036)
+.+..=.++.+|-..+--...|.+.++.+-+.|....+.|||+- ...+.++|.. +..+.++ +.+-.
T Consensus 146 lgGrKGHlAa~Dw~t~~L~~Ei~v~Etv~Dv~~LHneq~~AVAQ-----------K~y~yvYD~~-GtElHCl--k~~~~ 211 (545)
T KOG1272|consen 146 LGGRKGHLAAFDWVTKKLHFEINVMETVRDVTFLHNEQFFAVAQ-----------KKYVYVYDNN-GTELHCL--KRHIR 211 (545)
T ss_pred ecCCccceeeeecccceeeeeeehhhhhhhhhhhcchHHHHhhh-----------hceEEEecCC-CcEEeeh--hhcCc
Confidence 33444455566655443445688899999999988888888873 3466777763 3333221 11111
Q ss_pred EeEEEEEEEcCCCceEEEEEeeeeCCCCCCCcceEEEEEEEeCCeEEEEEEEEe-cCceeEecc--ccCeEEEE-ECCEE
Q 001655 716 GCSILSCSFSDDSNVYYCVGTAYVLPEENEPTKGRILVFIVEDGKLQLIAEKET-KGAVYSLNA--FNGKLLAA-INQKI 791 (1036)
Q Consensus 716 v~si~~~~l~~~~~~~i~VGT~~~~~~e~~~~~Gri~v~~i~~~kl~~~~~~~~-~g~v~~i~~--~~g~Lv~~-~g~~l 791 (1036)
+.-+. | -..+|++|+.+ ..|.+.-.++.-+++ |.+..+ .|++..+++ +|.=+-.+ .|.+|
T Consensus 212 v~rLe---F--LPyHfLL~~~~---------~~G~L~Y~DVS~Gkl--Va~~~t~~G~~~vm~qNP~NaVih~GhsnGtV 275 (545)
T KOG1272|consen 212 VARLE---F--LPYHFLLVAAS---------EAGFLKYQDVSTGKL--VASIRTGAGRTDVMKQNPYNAVIHLGHSNGTV 275 (545)
T ss_pred hhhhc---c--cchhheeeecc---------cCCceEEEeechhhh--hHHHHccCCccchhhcCCccceEEEcCCCceE
Confidence 11111 1 13678887763 457777677764443 333322 344444442 23322222 33567
Q ss_pred EEEEeeecCCCccchhcccccccceEEEEEEEeCCEEEEEeccccEEEEEE
Q 001655 792 QLYKWMLRDDGTRELQSECGHHGHILALYVQTRGDFIVVGDLMKSISLLIY 842 (1036)
Q Consensus 792 ~v~~~~~~~~~~~~L~~~~~~~~~~~~~~l~~~~~~I~vgD~~~Sv~~~~~ 842 (1036)
-+|+.+ ...-|...-.+.+++..+.+.-.|.|.+..-+-+.+-++-.
T Consensus 276 SlWSP~----skePLvKiLcH~g~V~siAv~~~G~YMaTtG~Dr~~kIWDl 322 (545)
T KOG1272|consen 276 SLWSPN----SKEPLVKILCHRGPVSSIAVDRGGRYMATTGLDRKVKIWDL 322 (545)
T ss_pred EecCCC----CcchHHHHHhcCCCcceEEECCCCcEEeecccccceeEeee
Confidence 775532 23335554445566666666677889888888888877543
No 278
>PF04762 IKI3: IKI3 family; InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=20.32 E-value=1.9e+03 Score=28.33 Aligned_cols=74 Identities=18% Similarity=0.140 Sum_probs=44.4
Q ss_pred ceeEEEEcCCCCCCCCcccEEEEEEecCCEEEEEECCCCCeeEEecCCCccCceeEEeeee--cCeEEEEEEeCCCcEEE
Q 001655 478 YEISCLDINPIGENPSYSQIAAVGMWTDISVRIFSLPDLNLITKEHLGGEIIPRSVLLCAF--EGISYLLCALGDGHLLN 555 (1036)
Q Consensus 478 ~~is~l~~~~~~~~~~~~~~~~vg~w~~~~i~i~~l~~l~~v~~~~l~~~~~p~si~~~~~--~~~~~L~vgl~~G~l~~ 555 (1036)
..|..|..++ .++.++|-+ ...|++|...+..--.++.+..... ..+....+ +....|.+++.+|.+..
T Consensus 305 ~~v~~l~Wn~------ds~iLAv~~--~~~vqLWt~~NYHWYLKqei~~~~~-~~~~~~~Wdpe~p~~L~v~t~~g~~~~ 375 (928)
T PF04762_consen 305 EKVIELAWNS------DSEILAVWL--EDRVQLWTRSNYHWYLKQEIRFSSS-ESVNFVKWDPEKPLRLHVLTSNGQYEI 375 (928)
T ss_pred ceeeEEEECC------CCCEEEEEe--cCCceEEEeeCCEEEEEEEEEccCC-CCCCceEECCCCCCEEEEEecCCcEEE
Confidence 4566666643 377888844 4459999988755444443331101 01111233 24557999999999998
Q ss_pred EEEec
Q 001655 556 FLLNM 560 (1036)
Q Consensus 556 y~~~~ 560 (1036)
|++..
T Consensus 376 ~~~~~ 380 (928)
T PF04762_consen 376 YDFAW 380 (928)
T ss_pred EEEEE
Confidence 88764
No 279
>PF15492 Nbas_N: Neuroblastoma-amplified sequence, N terminal
Probab=20.16 E-value=1.1e+03 Score=25.35 Aligned_cols=132 Identities=14% Similarity=0.162 Sum_probs=71.6
Q ss_pred eEEEEeCCeEEEEEEcCCCCeEEEEEeCCCc--c--ceEEEecCCCEEEEEEeecCCCCCceeeEEEEEEeCCCceEEEE
Q 001655 632 SLAIAKEGELTIGTIDDIQKLHIRSIPLGEH--P--RRICHQEQSRTFAICSLKNQSCAEESEMHFVRLLDDQTFEFIST 707 (1036)
Q Consensus 632 ~l~~~~~~~l~i~~l~~~~~~~~~~i~l~~t--p--~~i~y~~~~~~~~v~~~~~~~~~~~~~~~~l~l~d~~t~~~i~~ 707 (1036)
-++.+.+..+.|=+..+.-...+.|..+... | ||++++|+...+|.+.+. +.|+++|-.. ..+..
T Consensus 11 ~lAi~qd~~iEiRsa~Ddf~si~~kcqVpkD~~PQWRkl~WSpD~tlLa~a~S~----------G~i~vfdl~g-~~lf~ 79 (282)
T PF15492_consen 11 LLAILQDQCIEIRSAKDDFSSIIGKCQVPKDPNPQWRKLAWSPDCTLLAYAEST----------GTIRVFDLMG-SELFV 79 (282)
T ss_pred EEEEEeccEEEEEeccCCchheeEEEecCCCCCchheEEEECCCCcEEEEEcCC----------CeEEEEeccc-ceeEE
Confidence 3455556666666655544445555555443 3 899999987777766543 5777777532 22221
Q ss_pred ------EECCCCCeEeEEEEEEEcCC-C--ceEEEEEeeeeCCCCCCCcceEEEEEEEe---CCeEEEEEEEEe----cC
Q 001655 708 ------YPLDTFEYGCSILSCSFSDD-S--NVYYCVGTAYVLPEENEPTKGRILVFIVE---DGKLQLIAEKET----KG 771 (1036)
Q Consensus 708 ------~~~~~~E~v~si~~~~l~~~-~--~~~i~VGT~~~~~~e~~~~~Gri~v~~i~---~~kl~~~~~~~~----~g 771 (1036)
+..+-.-.+..|.....+.. + .+++||. .+|.+.-|-+. +.+.+.-|+..+ +.
T Consensus 80 I~p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~-----------Y~G~L~Sy~vs~gt~q~y~e~hsfsf~~~yp~ 148 (282)
T PF15492_consen 80 IPPAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVIN-----------YRGQLRSYLVSVGTNQGYQENHSFSFSSHYPH 148 (282)
T ss_pred cCcccccCCccccceeeeEeeccccccccceeEEEEe-----------ccceeeeEEEEcccCCcceeeEEEEecccCCC
Confidence 11111222333333333221 1 3566654 45777767664 346666666654 55
Q ss_pred ceeEeccccC-eEEE
Q 001655 772 AVYSLNAFNG-KLLA 785 (1036)
Q Consensus 772 ~v~~i~~~~g-~Lv~ 785 (1036)
.|.+++...+ +|++
T Consensus 149 Gi~~~vy~p~h~LLl 163 (282)
T PF15492_consen 149 GINSAVYHPKHRLLL 163 (282)
T ss_pred ceeEEEEcCCCCEEE
Confidence 7777775544 5554
No 280
>PF09288 UBA_3: Fungal ubiquitin-associated domain ; InterPro: IPR015368 This C-terminal domain is found in ubiquitin binding proteins, it adopts a structure consisting of a three alpha-helix bundle. This domain is predominantly found in fungi []. ; PDB: 1TTE_A.
Probab=20.06 E-value=1.7e+02 Score=22.85 Aligned_cols=39 Identities=28% Similarity=0.509 Sum_probs=26.7
Q ss_pred EehhHHHHHhcCC--HHHHHHHHHhcCCC------HHHHHHHHHHHh
Q 001655 995 LDGDLIESFLDLS--RTRMDEISKTMNVS------VEELCKRVEELT 1033 (1036)
Q Consensus 995 iDGdll~~fl~l~--~~~q~~i~~~~~~~------~~~i~~~l~~l~ 1033 (1036)
+|-+++.+|..|. .++-.++.+++|++ .+...+.||||=
T Consensus 8 i~~~lVd~F~~mGF~~dkVvevlrrlgik~~n~~dn~t~~~ilEELL 54 (55)
T PF09288_consen 8 IDKDLVDQFENMGFERDKVVEVLRRLGIKSMNGVDNETENKILEELL 54 (55)
T ss_dssp -SHHHHHHHHHHT--HHHHHHHHHHS--SS--SS--HHHHHHHHHHT
T ss_pred CCHHHHHHHHHcCCcHHHHHHHHHHhCCCCCCCccchhHHHHHHHHh
Confidence 7889999999875 55566778888753 455678888873
Done!