Query         000080
Match_columns 2389
No_of_seqs    459 out of 1132
Neff          4.1 
Searched_HMMs 46136
Date          Thu Mar 28 17:06:52 2013
Command       hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/000080.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/000080hhsearch_cdd -cpu 12 -v 0 

 No Hit                             Prob E-value P-value  Score    SS Cols Query HMM  Template HMM
  1 KOG1064 RAVE (regulator of V-A 100.0   0E+00   0E+00 3012.8  89.5 2154   31-2386    5-2356(2439)
  2 PF12234 Rav1p_C:  RAVE protein 100.0  1E-141  3E-146 1321.0  57.8  618  747-1483    1-631 (631)
  3 KOG0645 WD40 repeat protein [G 100.0 2.3E-29   5E-34  285.0  20.4  165   85-286     7-181 (312)
  4 KOG0645 WD40 repeat protein [G  99.9 3.2E-27   7E-32  267.7  17.4  201   36-285   103-311 (312)
  5 KOG0276 Vesicle coat complex C  99.9   4E-26 8.7E-31  276.7  13.4  175 2185-2384   68-245 (794)
  6 KOG0318 WD40 repeat stress pro  99.9 2.3E-22   5E-27  241.9  27.3  288   27-370     4-353 (603)
  7 KOG0272 U4/U6 small nuclear ri  99.9 7.4E-23 1.6E-27  242.1  12.1  173 2191-2384  272-448 (459)
  8 KOG0272 U4/U6 small nuclear ri  99.9 1.1E-22 2.4E-27  240.6   9.4  173 2189-2383  227-405 (459)
  9 KOG0271 Notchless-like WD40 re  99.8 1.7E-20 3.6E-25  219.9  13.3  135 2221-2374  117-255 (480)
 10 KOG0266 WD40 repeat-containing  99.8 8.1E-20 1.8E-24  227.0  18.9  145 2220-2385  204-353 (456)
 11 KOG0263 Transcription initiati  99.8 3.7E-20 8.1E-25  231.6  13.5  144 2220-2384  452-595 (707)
 12 KOG0279 G protein beta subunit  99.8   4E-19 8.6E-24  203.3  19.4  225 2082-2380   16-247 (315)
 13 KOG0263 Transcription initiati  99.8 1.2E-19 2.7E-24  227.0  16.2  139 2196-2354  509-651 (707)
 14 KOG0319 WD40-repeat-containing  99.8 2.2E-19 4.7E-24  222.8  15.0  174 2188-2383  420-606 (775)
 15 KOG0286 G-protein beta subunit  99.8 1.5E-18 3.4E-23  199.2  16.2  167 2189-2379  161-328 (343)
 16 KOG0271 Notchless-like WD40 re  99.8 1.8E-18 3.9E-23  203.0  13.5  163 2193-2377  128-299 (480)
 17 KOG0295 WD40 repeat-containing  99.8   3E-18 6.6E-23  200.9  15.0  173 2189-2384  159-352 (406)
 18 KOG0266 WD40 repeat-containing  99.8 4.3E-18 9.3E-23  211.7  16.5  145 2221-2385  161-307 (456)
 19 KOG0292 Vesicle coat complex C  99.8   5E-18 1.1E-22  212.2  14.5  176 2192-2384   63-268 (1202)
 20 KOG0279 G protein beta subunit  99.7   1E-17 2.2E-22  191.9  15.5  162 2198-2380   40-206 (315)
 21 KOG0291 WD40-repeat-containing  99.7 1.5E-17 3.3E-22  206.4  17.2  146 2220-2381  351-535 (893)
 22 PTZ00421 coronin; Provisional   99.7 9.7E-17 2.1E-21  201.6  19.1  142 2221-2383   77-228 (493)
 23 KOG0273 Beta-transducin family  99.7 1.1E-16 2.3E-21  192.2  17.4  195 2175-2383  233-469 (524)
 24 KOG0292 Vesicle coat complex C  99.7 5.5E-17 1.2E-21  203.1  13.2  162 2203-2384   31-224 (1202)
 25 KOG0295 WD40 repeat-containing  99.7 2.3E-16   5E-21  185.3  14.1  167 2193-2383  206-393 (406)
 26 KOG0315 G-protein beta subunit  99.7 5.1E-16 1.1E-20  175.9  14.8  180 2185-2383   45-275 (311)
 27 KOG0285 Pleiotropic regulator   99.7 3.8E-16 8.2E-21  182.7  13.2  136 2220-2376  152-287 (460)
 28 PTZ00421 coronin; Provisional   99.7 2.3E-15 4.9E-20  189.4  20.1  173 2192-2382   88-275 (493)
 29 PTZ00420 coronin; Provisional   99.7 1.7E-15 3.8E-20  192.5  19.2  149 2221-2384   76-232 (568)
 30 KOG0286 G-protein beta subunit  99.7   8E-16 1.7E-20  177.2  14.6  142 2220-2383  146-290 (343)
 31 KOG0319 WD40-repeat-containing  99.7 4.4E-16 9.5E-21  193.9  13.3  180 2193-2385  378-566 (775)
 32 KOG0284 Polyadenylation factor  99.7 1.5E-16 3.2E-21  188.7   8.7  143 2221-2384  140-282 (464)
 33 KOG0315 G-protein beta subunit  99.6 1.7E-15 3.8E-20  171.6  15.6  171 2193-2374   96-308 (311)
 34 KOG0285 Pleiotropic regulator   99.6 1.2E-15 2.7E-20  178.6  13.8  172 2192-2385  163-338 (460)
 35 KOG0276 Vesicle coat complex C  99.6 1.2E-15 2.6E-20  186.9  14.1  144 2217-2379   53-196 (794)
 36 KOG0284 Polyadenylation factor  99.6 3.9E-16 8.5E-21  185.1   9.7  178 2179-2379  181-363 (464)
 37 KOG0293 WD40 repeat-containing  99.6 4.2E-15 9.1E-20  176.4  16.4  212   35-287   221-515 (519)
 38 PLN00181 protein SPA1-RELATED;  99.6 6.4E-15 1.4E-19  194.2  20.0  172 2193-2385  546-727 (793)
 39 KOG0273 Beta-transducin family  99.6 6.3E-15 1.4E-19  177.3  15.0  140 2220-2381  360-508 (524)
 40 PLN00181 protein SPA1-RELATED;  99.6 1.7E-14 3.6E-19  190.3  19.9  171 2191-2384  494-678 (793)
 41 cd00200 WD40 WD40 domain, foun  99.6 3.2E-14 6.9E-19  153.9  18.4  144 2221-2385   11-154 (289)
 42 KOG0316 Conserved WD40 repeat-  99.6 6.3E-15 1.4E-19  166.1  13.0  113 2221-2352   19-131 (307)
 43 KOG0275 Conserved WD40 repeat-  99.6 1.2E-15 2.7E-20  176.0   6.6  164 2194-2378  227-404 (508)
 44 KOG0265 U5 snRNP-specific prot  99.6 1.2E-14 2.7E-19  168.1  14.7  171 2191-2384   58-234 (338)
 45 cd00200 WD40 WD40 domain, foun  99.6 7.3E-14 1.6E-18  151.1  18.6  168 2194-2383   23-194 (289)
 46 PTZ00420 coronin; Provisional   99.6 7.2E-14 1.6E-18  177.9  21.3  153 2191-2362   86-257 (568)
 47 KOG0267 Microtubule severing p  99.6 2.6E-15 5.6E-20  186.6   7.1  166 2195-2383   43-212 (825)
 48 KOG0269 WD40 repeat-containing  99.6 1.6E-14 3.4E-19  180.9  12.9  144 2223-2385  137-282 (839)
 49 KOG0301 Phospholipase A2-activ  99.5 2.6E-14 5.6E-19  177.5  14.0  164 2190-2382  110-275 (745)
 50 KOG0281 Beta-TrCP (transducin   99.5 4.9E-15 1.1E-19  172.7   6.5  166 2191-2377  206-411 (499)
 51 KOG0310 Conserved WD40 repeat-  99.5 4.4E-14 9.6E-19  171.0  14.4  143 2221-2384  112-256 (487)
 52 KOG0275 Conserved WD40 repeat-  99.5 3.5E-15 7.7E-20  172.3   4.7  151 2221-2384  215-366 (508)
 53 KOG0318 WD40 repeat stress pro  99.5 7.6E-14 1.7E-18  169.6  15.7  166 2198-2384  131-338 (603)
 54 KOG0291 WD40-repeat-containing  99.5 6.3E-14 1.4E-18  174.9  14.6  144 2221-2383  309-495 (893)
 55 KOG0277 Peroxisomal targeting   99.5   1E-13 2.3E-18  157.9  14.5  146 2221-2385  106-253 (311)
 56 KOG1332 Vesicle coat complex C  99.5 1.4E-13 3.1E-18  156.2  14.8  212   36-292    54-293 (299)
 57 KOG0308 Conserved WD40 repeat-  99.5 1.7E-13 3.8E-18  169.4  16.5  177 2194-2383   87-272 (735)
 58 KOG0283 WD40 repeat-containing  99.5 5.2E-14 1.1E-18  178.4  12.2  153 2218-2383  266-468 (712)
 59 KOG0267 Microtubule severing p  99.5 1.5E-14 3.3E-19  179.8   7.3  162 2202-2386   91-258 (825)
 60 KOG0305 Anaphase promoting com  99.5 1.7E-13 3.7E-18  170.2  14.6  155 2221-2383  219-448 (484)
 61 KOG0265 U5 snRNP-specific prot  99.5   2E-13 4.3E-18  158.3  13.5  172 2194-2383  147-325 (338)
 62 KOG0306 WD40-repeat-containing  99.5 4.9E-13 1.1E-17  167.1  17.6  165 2200-2385  473-653 (888)
 63 KOG0274 Cdc4 and related F-box  99.5 3.1E-13 6.8E-18  171.5  16.3  132 2220-2376  250-381 (537)
 64 KOG0973 Histone transcription   99.5 1.1E-12 2.4E-17  169.8  19.8  214   36-283    67-310 (942)
 65 KOG0647 mRNA export protein (c  99.5 7.1E-13 1.5E-17  153.9  15.3  123 2221-2363   29-154 (347)
 66 KOG0313 Microtubule binding pr  99.5 5.3E-13 1.1E-17  158.2  14.3  169 2190-2377  203-400 (423)
 67 KOG0282 mRNA splicing factor [  99.5 1.3E-13 2.9E-18  166.7   9.6  173 2189-2383  224-402 (503)
 68 KOG0302 Ribosome Assembly prot  99.4 7.7E-13 1.7E-17  156.6  15.4  158 2172-2352  220-378 (440)
 69 KOG0310 Conserved WD40 repeat-  99.4 3.6E-13 7.8E-18  163.3  11.7  142 2222-2383   71-213 (487)
 70 KOG0772 Uncharacterized conser  99.4 8.3E-13 1.8E-17  160.2  14.3  182 2194-2384  181-382 (641)
 71 KOG0277 Peroxisomal targeting   99.4 1.3E-12 2.8E-17  149.1  14.8  141 2222-2382   63-206 (311)
 72 KOG0973 Histone transcription   99.4 8.5E-13 1.9E-17  170.8  14.9  143 2220-2383   70-236 (942)
 73 KOG0282 mRNA splicing factor [  99.4 7.8E-14 1.7E-18  168.7   5.1  141 2221-2384  216-360 (503)
 74 KOG0647 mRNA export protein (c  99.4 1.5E-12 3.3E-17  151.2  15.1  186 2176-2380   25-307 (347)
 75 KOG0274 Cdc4 and related F-box  99.4 6.2E-13 1.3E-17  168.8  13.0  156 2192-2374  261-421 (537)
 76 KOG0308 Conserved WD40 repeat-  99.4 3.4E-13 7.3E-18  166.9  10.1  169 2200-2384   51-231 (735)
 77 KOG0640 mRNA cleavage stimulat  99.4 2.8E-13 6.1E-18  156.9   8.0  148 2221-2384  174-323 (430)
 78 KOG0313 Microtubule binding pr  99.4 1.5E-12 3.2E-17  154.5  13.6  176 2194-2382  161-361 (423)
 79 KOG0264 Nucleosome remodeling   99.4 1.4E-12   3E-17  157.5  13.4  145 2221-2382  229-389 (422)
 80 KOG0281 Beta-TrCP (transducin   99.4 3.3E-13 7.1E-18  157.8   6.9  131 2221-2376  322-459 (499)
 81 KOG1407 WD40 repeat protein [F  99.4 1.3E-12 2.7E-17  149.7  11.4  150 2221-2384   22-249 (313)
 82 KOG0303 Actin-binding protein   99.4 8.6E-13 1.9E-17  156.8  10.4  134 2221-2369   83-218 (472)
 83 KOG1332 Vesicle coat complex C  99.4 1.7E-12 3.6E-17  147.7  10.9  178   86-286     4-194 (299)
 84 KOG0640 mRNA cleavage stimulat  99.4 2.8E-12 6.1E-17  148.8  12.6  154 2192-2364  184-345 (430)
 85 KOG0316 Conserved WD40 repeat-  99.4 2.5E-12 5.4E-17  145.6  11.8  163 2200-2385   36-202 (307)
 86 KOG0289 mRNA splicing factor [  99.4 7.4E-12 1.6E-16  150.2  16.1  163 2200-2381  280-447 (506)
 87 KOG0264 Nucleosome remodeling   99.4 2.9E-12 6.3E-17  154.7  12.6  148 2224-2382  182-332 (422)
 88 KOG0278 Serine/threonine kinas  99.4 1.6E-12 3.4E-17  147.9   9.3  164 2194-2379   73-280 (334)
 89 KOG0289 mRNA splicing factor [  99.3 4.8E-12   1E-16  151.8  13.6  142 2220-2380  348-490 (506)
 90 KOG2445 Nuclear pore complex c  99.3 9.6E-11 2.1E-15  136.8  23.6  248   49-323    22-312 (361)
 91 KOG0293 WD40 repeat-containing  99.3 7.3E-12 1.6E-16  149.4  12.7  144 2221-2385  226-373 (519)
 92 KOG1063 RNA polymerase II elon  99.3   2E-09 4.3E-14  135.1  33.8  603   31-909     7-640 (764)
 93 KOG0296 Angio-associated migra  99.3 1.9E-11 4.1E-16  144.8  15.3  143 2220-2383   65-207 (399)
 94 KOG0306 WD40-repeat-containing  99.3 1.2E-11 2.5E-16  155.1  13.5  137 2220-2378  455-604 (888)
 95 KOG1009 Chromatin assembly com  99.3 1.5E-11 3.2E-16  147.2  10.9  153 2220-2384   14-183 (434)
 96 KOG0772 Uncharacterized conser  99.3 5.4E-11 1.2E-15  144.9  15.4  298   16-365   148-466 (641)
 97 KOG1407 WD40 repeat protein [F  99.2 7.1E-11 1.5E-15  135.7  14.9  177 2189-2378   74-284 (313)
 98 KOG2445 Nuclear pore complex c  99.2   6E-10 1.3E-14  130.3  21.9  264   89-384    10-322 (361)
 99 KOG0302 Ribosome Assembly prot  99.2 4.3E-11 9.4E-16  142.1  12.8  147 2223-2383  215-366 (440)
100 KOG1064 RAVE (regulator of V-A  99.2 1.4E-08   3E-13  136.0  36.6  193   15-214    18-255 (2439)
101 KOG0646 WD40 repeat protein [G  99.2 5.7E-11 1.2E-15  144.0  13.7  152 2220-2384   82-295 (476)
102 KOG0301 Phospholipase A2-activ  99.2 4.1E-11 8.9E-16  149.8  12.4  132 2223-2383  105-236 (745)
103 KOG0296 Angio-associated migra  99.2 1.1E-10 2.4E-15  138.5  15.4  145 2223-2384  152-386 (399)
104 KOG0294 WD40 repeat-containing  99.2 9.2E-11   2E-15  137.3  13.1  137 2222-2384   46-187 (362)
105 KOG0299 U3 snoRNP-associated p  99.2 4.5E-11 9.7E-16  144.7  10.7  144 2220-2374  143-294 (479)
106 KOG1446 Histone H3 (Lys4) meth  99.2 2.9E-10 6.3E-15  133.5  16.8  151 2220-2382   15-203 (311)
107 KOG0300 WD40 repeat-containing  99.2 4.4E-11 9.6E-16  139.0   9.2  175 2190-2383  122-331 (481)
108 KOG0288 WD40 repeat protein Ti  99.2 2.8E-11   6E-16  144.9   7.4  171 2190-2386  184-361 (459)
109 KOG0643 Translation initiation  99.2 1.8E-10 3.9E-15  132.7  13.4  152 2220-2382   53-247 (327)
110 KOG0299 U3 snoRNP-associated p  99.2 9.3E-11   2E-15  142.0  11.6  136 2220-2377  203-338 (479)
111 KOG1034 Transcriptional repres  99.2 4.9E-11 1.1E-15  140.0   8.8  144 2223-2384   93-267 (385)
112 KOG0283 WD40 repeat-containing  99.2 1.7E-10 3.8E-15  147.2  13.8  108 2222-2351  372-480 (712)
113 KOG1539 WD repeat protein [Gen  99.1 1.7E-10 3.6E-15  146.5  12.9  176 2183-2383  459-634 (910)
114 KOG0300 WD40 repeat-containing  99.1 2.9E-10 6.3E-15  132.4  13.3  156 2200-2377  291-455 (481)
115 KOG0639 Transducin-like enhanc  99.1   7E-11 1.5E-15  143.1   7.7  143 2220-2382  466-608 (705)
116 PF08662 eIF2A:  Eukaryotic tra  99.1 7.6E-10 1.6E-14  124.7  15.3  116 2221-2361   61-185 (194)
117 TIGR03866 PQQ_ABC_repeats PQQ-  99.1 1.3E-09 2.8E-14  123.6  17.2  139 2223-2376  160-300 (300)
118 KOG0269 WD40 repeat-containing  99.1 8.2E-11 1.8E-15  148.4   7.9  144 2222-2384   90-238 (839)
119 KOG0643 Translation initiation  99.1 5.5E-10 1.2E-14  128.8  13.9  148 2223-2386   14-210 (327)
120 KOG0641 WD40 repeat protein [G  99.1 9.7E-10 2.1E-14  123.9  15.5  144 2220-2372   33-189 (350)
121 COG2319 FOG: WD40 repeat [Gene  99.1 1.8E-09   4E-14  121.1  17.6  142 2221-2383  157-301 (466)
122 KOG1034 Transcriptional repres  99.1 4.6E-10   1E-14  132.0  12.0  158 2221-2389  137-376 (385)
123 KOG0288 WD40 repeat protein Ti  99.1 9.6E-10 2.1E-14  132.1  14.7  166 2197-2385  278-450 (459)
124 TIGR03866 PQQ_ABC_repeats PQQ-  99.1 1.3E-09 2.9E-14  123.5  15.1  130 2231-2383    1-131 (300)
125 KOG1274 WD40 repeat protein [G  99.1 1.1E-09 2.3E-14  140.6  15.6  171 2190-2380  106-284 (933)
126 KOG0278 Serine/threonine kinas  99.1 5.9E-11 1.3E-15  135.4   3.8  139 2221-2381   61-199 (334)
127 KOG4283 Transcription-coupled   99.0 2.2E-09 4.8E-14  124.8  15.1  145 2220-2384  102-264 (397)
128 KOG2096 WD40 repeat protein [G  99.0 1.9E-09 4.1E-14  126.3  13.9  116 2221-2351  189-307 (420)
129 KOG1063 RNA polymerase II elon  99.0 9.6E-10 2.1E-14  137.8  12.3  144 2220-2378  526-676 (764)
130 KOG0639 Transducin-like enhanc  99.0 5.1E-10 1.1E-14  135.9   9.4  139 2223-2384  513-651 (705)
131 KOG0303 Actin-binding protein   99.0 3.4E-09 7.3E-14  126.9  16.0  144 2189-2351   91-248 (472)
132 KOG0294 WD40 repeat-containing  99.0 3.2E-09 6.9E-14  124.7  15.2  165 2195-2377   56-260 (362)
133 KOG0270 WD40 repeat-containing  99.0 3.1E-09 6.6E-14  128.8  15.4  172 2192-2382  256-434 (463)
134 KOG1446 Histone H3 (Lys4) meth  99.0 4.5E-09 9.7E-14  123.8  15.7  164 2200-2384   77-250 (311)
135 KOG0270 WD40 repeat-containing  99.0 2.3E-09   5E-14  129.9  12.8  136 2224-2378  248-385 (463)
136 KOG0641 WD40 repeat protein [G  99.0 4.3E-09 9.4E-14  118.8  14.1  145 2191-2351  193-348 (350)
137 KOG2096 WD40 repeat protein [G  99.0 1.5E-08 3.3E-13  119.0  18.6  210   36-285    84-308 (420)
138 KOG1445 Tumor-specific antigen  99.0 8.4E-10 1.8E-14  136.1   8.2  120 2221-2352  629-750 (1012)
139 KOG1007 WD repeat protein TSSC  99.0 3.7E-09   8E-14  122.9  12.7  144 2221-2379  125-271 (370)
140 KOG4328 WD40 protein [Function  99.0 2.6E-09 5.6E-14  129.7  11.9  161 2215-2385  182-388 (498)
141 KOG1445 Tumor-specific antigen  99.0 3.4E-09 7.4E-14  130.9  12.7  150 2226-2386  586-740 (1012)
142 COG2319 FOG: WD40 repeat [Gene  99.0 1.3E-08 2.9E-13  114.3  16.5  139 2222-2382  112-257 (466)
143 KOG0305 Anaphase promoting com  99.0 1.3E-08 2.9E-13  127.5  18.0  203   33-291   255-467 (484)
144 KOG1539 WD repeat protein [Gen  98.9 2.2E-09 4.8E-14  136.6  10.7  142 2189-2350  502-646 (910)
145 PF08662 eIF2A:  Eukaryotic tra  98.9 1.3E-08 2.9E-13  114.7  15.8  139 2223-2383    9-160 (194)
146 KOG1274 WD40 repeat protein [G  98.9 6.2E-09 1.3E-13  133.9  14.5  141 2221-2382   98-248 (933)
147 KOG2048 WD40 repeat protein [G  98.9 8.1E-09 1.8E-13  129.7  14.3  147 2220-2383  111-262 (691)
148 KOG0771 Prolactin regulatory e  98.9 5.9E-09 1.3E-13  126.1  12.2  144 2223-2383  148-341 (398)
149 KOG1007 WD repeat protein TSSC  98.9 5.4E-09 1.2E-13  121.6  11.1  139 2223-2378  174-342 (370)
150 KOG4328 WD40 protein [Function  98.9 2.6E-08 5.5E-13  121.3  16.6  145 2191-2351  246-398 (498)
151 KOG0290 Conserved WD40 repeat-  98.9 6.7E-08 1.5E-12  112.9  19.0  255    7-289    11-322 (364)
152 KOG0307 Vesicle coat complex C  98.9 5.1E-09 1.1E-13  137.2  10.7  176 2193-2383   81-271 (1049)
153 KOG0642 Cell-cycle nuclear pro  98.9 4.2E-09 9.2E-14  130.3   9.3  118 2221-2352  296-426 (577)
154 KOG0321 WD40 repeat-containing  98.9 8.3E-09 1.8E-13  128.8  11.4  163 2210-2385   93-290 (720)
155 KOG0646 WD40 repeat protein [G  98.9 1.9E-08 4.1E-13  122.8  13.7  159 2199-2374  148-327 (476)
156 KOG1036 Mitotic spindle checkp  98.8 2.5E-08 5.5E-13  117.3  14.1  110 2221-2352   15-124 (323)
157 KOG4283 Transcription-coupled   98.8 1.2E-08 2.7E-13  118.8  11.2  147 2189-2351  111-275 (397)
158 KOG1009 Chromatin assembly com  98.8   4E-08 8.6E-13  118.6  15.1  156   95-280    14-190 (434)
159 KOG2394 WD40 protein DMR-N9 [G  98.8 8.5E-09 1.8E-13  126.9   9.5   92 2221-2327  292-383 (636)
160 KOG0268 Sof1-like rRNA process  98.8 7.3E-09 1.6E-13  123.2   8.6  114 2221-2352  231-345 (433)
161 KOG1523 Actin-related protein   98.8 5.2E-08 1.1E-12  115.1  14.9  155   96-284    12-175 (361)
162 KOG0268 Sof1-like rRNA process  98.8 7.2E-09 1.6E-13  123.3   7.8  162 2203-2384  167-333 (433)
163 KOG1036 Mitotic spindle checkp  98.8 3.9E-08 8.4E-13  115.8  13.6  183 2176-2379   11-287 (323)
164 KOG0649 WD40 repeat protein [G  98.8   5E-08 1.1E-12  111.8  14.1  152 2196-2366   83-249 (325)
165 PRK01742 tolB translocation pr  98.8 2.8E-08 6.1E-13  123.6  13.0  139 2221-2383  205-349 (429)
166 KOG0644 Uncharacterized conser  98.8 2.7E-09 5.8E-14  135.2   4.0  109 2221-2352  192-300 (1113)
167 KOG1273 WD40 repeat protein [G  98.8 7.3E-08 1.6E-12  113.4  14.0  155 2215-2385   19-215 (405)
168 PRK05137 tolB translocation pr  98.7 1.8E-07 3.9E-12  116.5  16.7  141 2221-2382  203-349 (435)
169 KOG0650 WD40 repeat nucleolar   98.7 1.6E-07 3.5E-12  116.9  15.4  144 2221-2379  402-579 (733)
170 KOG1188 WD40 repeat protein [G  98.7 1.2E-07 2.5E-12  112.8  11.6  139 2195-2352   51-196 (376)
171 KOG0650 WD40 repeat nucleolar   98.6   7E-07 1.5E-11  111.4  18.6  235   16-283   369-678 (733)
172 PRK11028 6-phosphogluconolacto  98.6 5.8E-07 1.3E-11  107.2  16.6  154 2222-2385  128-292 (330)
173 KOG0322 G-protein beta subunit  98.6 3.8E-08 8.3E-13  113.8   6.0   76 2215-2300  247-322 (323)
174 KOG0290 Conserved WD40 repeat-  98.6 1.7E-07 3.7E-12  109.6  11.3  120 2221-2352  152-318 (364)
175 KOG1272 WD40-repeat-containing  98.6 3.6E-08 7.7E-13  120.2   5.8  143 2220-2384  210-352 (545)
176 KOG2055 WD40 repeat protein [G  98.6 1.4E-07 3.1E-12  115.1  10.9  149 2221-2382  346-499 (514)
177 KOG2919 Guanine nucleotide-bin  98.6 1.6E-07 3.4E-12  111.0  10.5  145 2227-2387  119-271 (406)
178 PRK02889 tolB translocation pr  98.6 3.3E-07 7.2E-12  114.3  14.1  144 2221-2383  197-344 (427)
179 KOG0974 WD-repeat protein WDR6  98.6 1.2E-07 2.6E-12  123.8  10.4  112 2220-2352  176-288 (967)
180 KOG4378 Nuclear protein COP1 [  98.6 3.9E-07 8.5E-12  111.6  13.9  160 2195-2380   94-264 (673)
181 KOG0649 WD40 repeat protein [G  98.6 3.2E-07   7E-12  105.4  12.3  138 2220-2377   63-219 (325)
182 KOG1310 WD40 repeat protein [G  98.6 1.3E-07 2.7E-12  116.7   9.4  122 2220-2354   51-180 (758)
183 KOG1408 WD40 repeat protein [F  98.6 3.3E-07 7.2E-12  115.2  12.3  154 2220-2384  460-701 (1080)
184 KOG2919 Guanine nucleotide-bin  98.5 3.4E-07 7.3E-12  108.3  11.4  137 2222-2377  210-351 (406)
185 PRK03629 tolB translocation pr  98.5 8.8E-07 1.9E-11  110.8  15.3  142 2221-2383  200-347 (429)
186 KOG4378 Nuclear protein COP1 [  98.5 7.3E-07 1.6E-11  109.3  13.8  137 2221-2378  166-305 (673)
187 KOG2394 WD40 protein DMR-N9 [G  98.5 5.4E-07 1.2E-11  111.6  12.7  150 2214-2376  214-384 (636)
188 KOG1188 WD40 repeat protein [G  98.5 3.6E-07 7.8E-12  108.9  10.5  133 2232-2379   41-178 (376)
189 KOG0307 Vesicle coat complex C  98.5 2.7E-07   6E-12  121.5   9.6  168 2191-2376  128-306 (1049)
190 KOG1538 Uncharacterized conser  98.5   8E-07 1.7E-11  111.1  12.7  139 2221-2377   14-187 (1081)
191 KOG1408 WD40 repeat protein [F  98.5   1E-06 2.2E-11  111.1  13.6  117 2219-2351  596-712 (1080)
192 PRK04922 tolB translocation pr  98.5 1.1E-06 2.4E-11  109.7  14.1  140 2222-2382  206-351 (433)
193 KOG4547 WD40 repeat-containing  98.5 8.7E-07 1.9E-11  111.2  12.8  105 2267-2384   98-207 (541)
194 PRK01742 tolB translocation pr  98.5 5.6E-07 1.2E-11  112.2  11.2  124 2238-2382  181-307 (429)
195 PRK11028 6-phosphogluconolacto  98.5 2.4E-06 5.2E-11  102.1  15.9  140 2222-2374  177-327 (330)
196 TIGR02800 propeller_TolB tol-p  98.5 2.3E-06   5E-11  104.7  15.8  139 2222-2383  192-338 (417)
197 KOG2106 Uncharacterized conser  98.4 2.3E-06 4.9E-11  105.6  14.9  138 2222-2384  371-509 (626)
198 KOG1524 WD40 repeat-containing  98.4 5.1E-06 1.1E-10  102.9  16.8  211   54-338    77-291 (737)
199 KOG2055 WD40 repeat protein [G  98.4 1.8E-06 3.8E-11  105.9  12.6  159 2204-2385  200-363 (514)
200 KOG1273 WD40 repeat protein [G  98.4   1E-06 2.2E-11  104.1   9.5   92 2274-2377   26-117 (405)
201 KOG0974 WD-repeat protein WDR6  98.4 1.9E-06 4.2E-11  113.0  12.9  135 2223-2380  137-272 (967)
202 KOG0642 Cell-cycle nuclear pro  98.4 2.1E-06 4.6E-11  107.2  12.3  155 2220-2383  345-548 (577)
203 KOG0644 Uncharacterized conser  98.3 1.9E-07   4E-12  119.2   2.9   99 2268-2377  187-285 (1113)
204 KOG4227 WD40 repeat protein [G  98.3 3.6E-06 7.8E-11  101.0  13.1  138 2221-2377   58-205 (609)
205 KOG2110 Uncharacterized conser  98.3 4.8E-06   1E-10  100.3  14.0  112 2221-2351  131-247 (391)
206 KOG1538 Uncharacterized conser  98.3 1.6E-05 3.5E-10  100.0  18.3  193   40-286    14-212 (1081)
207 KOG2048 WD40 repeat protein [G  98.3 8.5E-06 1.8E-10  103.5  16.2  145 2221-2385   27-173 (691)
208 KOG2110 Uncharacterized conser  98.3 1.1E-05 2.3E-10   97.5  15.9  140 2221-2381   89-233 (391)
209 PRK03629 tolB translocation pr  98.3 6.3E-06 1.4E-10  103.3  14.8  140 2223-2384  246-391 (429)
210 KOG0771 Prolactin regulatory e  98.3 1.9E-06 4.2E-11  104.9   9.5  151 2189-2351  153-353 (398)
211 KOG0322 G-protein beta subunit  98.3 1.4E-06   3E-11  101.4   7.7  113 2221-2351  207-322 (323)
212 PRK05137 tolB translocation pr  98.3 7.2E-06 1.6E-10  102.5  14.1  138 2223-2382  249-392 (435)
213 PRK00178 tolB translocation pr  98.2 1.4E-05   3E-10   99.3  16.2  139 2221-2382  200-346 (430)
214 PRK04922 tolB translocation pr  98.2 8.3E-06 1.8E-10  102.0  13.7  139 2223-2383  251-395 (433)
215 PRK04792 tolB translocation pr  98.2 1.5E-05 3.2E-10  100.6  15.4  140 2222-2382  220-365 (448)
216 KOG1524 WD40 repeat-containing  98.2 4.4E-06 9.5E-11  103.5   9.7  139 2221-2383  106-244 (737)
217 KOG3914 WD repeat protein WDR4  98.2 3.6E-06 7.9E-11  102.2   8.8  119 2222-2363  113-232 (390)
218 KOG2139 WD40 repeat protein [G  98.2 3.4E-05 7.3E-10   93.0  16.4  151   38-207   140-301 (445)
219 PRK01029 tolB translocation pr  98.2 0.00011 2.3E-09   92.7  21.4  200   42-290   188-407 (428)
220 KOG2139 WD40 repeat protein [G  98.2 2.9E-05 6.4E-10   93.5  15.4  186   56-286   113-310 (445)
221 KOG0321 WD40 repeat-containing  98.1 4.2E-06 9.1E-11  105.5   8.3  115 2225-2352   55-175 (720)
222 PRK02889 tolB translocation pr  98.1 1.4E-05 3.1E-10   99.9  13.0  141 2223-2383  243-387 (427)
223 KOG1517 Guanine nucleotide bin  98.1 6.1E-05 1.3E-09   99.1  18.4  134 2222-2376 1211-1361(1387)
224 PRK01029 tolB translocation pr  98.1 2.7E-05 5.9E-10   97.9  14.8  143 2224-2382  235-386 (428)
225 KOG4497 Uncharacterized conser  98.1 2.5E-05 5.5E-10   93.0  13.1  193   44-283    14-238 (447)
226 KOG1310 WD40 repeat protein [G  98.1 6.4E-06 1.4E-10  102.2   8.5  132  139-290    43-183 (758)
227 KOG2106 Uncharacterized conser  98.1 4.8E-05   1E-09   94.4  15.6  133 2197-2351  183-315 (626)
228 KOG1523 Actin-related protein   98.1 4.5E-05 9.8E-10   91.1  14.0  142 2221-2378   12-168 (361)
229 PF00400 WD40:  WD domain, G-be  98.0 9.4E-06   2E-10   68.3   5.7   39 2251-2299    1-39  (39)
230 KOG1587 Cytoplasmic dynein int  97.9 0.00018   4E-09   93.0  17.5  148 2220-2379  348-499 (555)
231 TIGR02800 propeller_TolB tol-p  97.9 8.7E-05 1.9E-09   91.1  14.0  139 2223-2383  237-381 (417)
232 KOG1240 Protein kinase contain  97.9 6.1E-05 1.3E-09  100.4  12.5  146 2225-2383 1055-1212(1431)
233 PRK04792 tolB translocation pr  97.9 0.00064 1.4E-08   86.2  20.7  198   41-292   220-430 (448)
234 KOG1963 WD40 repeat protein [G  97.9 5.9E-05 1.3E-09   98.4  11.5  132 2199-2351  184-321 (792)
235 KOG2111 Uncharacterized conser  97.8 9.6E-05 2.1E-09   88.3  10.4  105 2233-2352  150-256 (346)
236 KOG2111 Uncharacterized conser  97.8 8.4E-05 1.8E-09   88.8   9.8   75 2221-2303  183-258 (346)
237 KOG4547 WD40 repeat-containing  97.8 0.00024 5.3E-09   90.0  14.2  130 2220-2369  103-239 (541)
238 KOG3881 Uncharacterized conser  97.7  0.0002 4.2E-09   87.5  12.5  121 2220-2360  203-326 (412)
239 KOG2321 WD40 repeat protein [G  97.7 0.00014 3.1E-09   91.4  10.9  146 2220-2378  176-325 (703)
240 KOG1517 Guanine nucleotide bin  97.7 0.00029 6.3E-09   93.1  14.1  140 2225-2379 1171-1317(1387)
241 KOG1963 WD40 repeat protein [G  97.7 0.00029 6.4E-09   92.2  14.1  142 2223-2380  164-306 (792)
242 KOG4227 WD40 repeat protein [G  97.7 0.00037   8E-09   84.4  13.2  180 2191-2384   67-262 (609)
243 PF04762 IKI3:  IKI3 family;  I  97.7  0.0057 1.2E-07   84.1  26.0  238   37-342    74-367 (928)
244 KOG1272 WD40-repeat-containing  97.7 6.7E-05 1.4E-09   92.6   7.0  109 2221-2351  253-361 (545)
245 KOG2315 Predicted translation   97.6 0.00021 4.5E-09   90.1  10.4  130   95-252   271-410 (566)
246 PF02239 Cytochrom_D1:  Cytochr  97.6 0.00073 1.6E-08   84.0  15.1  129 2234-2383    9-145 (369)
247 PF00400 WD40:  WD domain, G-be  97.6 0.00013 2.8E-09   61.4   6.0   38 2309-2350    2-39  (39)
248 PF02239 Cytochrom_D1:  Cytochr  97.6  0.0022 4.8E-08   79.8  18.2  136 2224-2382   41-187 (369)
249 PRK00178 tolB translocation pr  97.5   0.001 2.2E-08   83.1  14.2  118 2242-2382  180-302 (430)
250 PF10282 Lactonase:  Lactonase,  97.5  0.0043 9.3E-08   76.1  19.2  127 2222-2357  194-327 (345)
251 KOG1587 Cytoplasmic dynein int  97.5 0.00034 7.3E-09   90.6  10.0  116 2219-2351  398-515 (555)
252 KOG0309 Conserved WD40 repeat-  97.5 0.00039 8.4E-09   89.2  10.0  194   41-286    27-233 (1081)
253 KOG3881 Uncharacterized conser  97.4  0.0009   2E-08   81.9  11.9  151 2222-2383  151-307 (412)
254 KOG2315 Predicted translation   97.3  0.0052 1.1E-07   78.1  17.3  225 2129-2383  128-371 (566)
255 KOG1334 WD40 repeat protein [G  97.3 0.00063 1.4E-08   84.8   9.3  117 2222-2352  145-263 (559)
256 KOG3914 WD repeat protein WDR4  97.3 0.00037 7.9E-09   85.5   6.7   73 2222-2304  154-226 (390)
257 PLN02919 haloacid dehalogenase  97.3  0.0033 7.1E-08   87.5  16.5  119 2223-2351  743-887 (1057)
258 PRK04043 tolB translocation pr  97.3   0.019 4.2E-07   72.8  21.7  200   42-290   191-403 (419)
259 PF10282 Lactonase:  Lactonase,  97.2  0.0099 2.2E-07   72.9  18.5  153 2221-2386  145-311 (345)
260 KOG4190 Uncharacterized conser  97.2 0.00068 1.5E-08   84.4   8.0  156 2203-2381  724-891 (1034)
261 PLN02919 haloacid dehalogenase  97.2  0.0067 1.4E-07   84.5  18.2  149 2223-2383  686-875 (1057)
262 KOG4497 Uncharacterized conser  97.2  0.0013 2.7E-08   79.2   9.1  134 2225-2381   14-148 (447)
263 PRK04043 tolB translocation pr  97.1  0.0057 1.2E-07   77.4  15.1  136 2222-2382  190-334 (419)
264 KOG1912 WD40 repeat protein [G  97.1   0.002 4.3E-08   83.5  10.9  143   29-198     5-165 (1062)
265 KOG1240 Protein kinase contain  97.0  0.0094   2E-07   80.8  16.4  165 2189-2363 1058-1282(1431)
266 KOG0280 Uncharacterized conser  96.9  0.0094   2E-07   71.5  13.1  137 2223-2377  125-264 (339)
267 KOG2695 WD40 repeat protein [G  96.8  0.0016 3.5E-08   78.8   6.3  134 2223-2375  256-401 (425)
268 KOG1354 Serine/threonine prote  96.7  0.0022 4.8E-08   77.6   6.5  140 2217-2366  162-314 (433)
269 KOG0280 Uncharacterized conser  96.7   0.006 1.3E-07   73.0   9.7   96 2220-2329  166-264 (339)
270 KOG2079 Vacuolar assembly/sort  96.6  0.0065 1.4E-07   81.5   9.5  107 2217-2337   85-193 (1206)
271 KOG4714 Nucleoporin [Nuclear s  96.6  0.0041 8.9E-08   73.5   6.8   73 2272-2351  180-253 (319)
272 KOG2314 Translation initiation  96.5   0.016 3.5E-07   73.6  11.6  168   45-252   170-356 (698)
273 smart00320 WD40 WD40 repeats.   96.4  0.0076 1.7E-07   46.3   5.6   30 2270-2299   11-40  (40)
274 PF15492 Nbas_N:  Neuroblastoma  96.4   0.046   1E-06   65.8  14.4  122 2223-2351   47-258 (282)
275 KOG0309 Conserved WD40 repeat-  96.4  0.0071 1.5E-07   78.3   8.0  133 2223-2374   71-209 (1081)
276 COG2706 3-carboxymuconate cycl  96.2    0.17 3.7E-06   62.5  17.8  151 2223-2382   92-259 (346)
277 KOG1409 Uncharacterized conser  96.2   0.014 3.1E-07   71.0   8.4   74 2221-2303  199-272 (404)
278 PF11768 DUF3312:  Protein of u  96.0   0.021 4.5E-07   73.6   9.4   69 2272-2351  260-328 (545)
279 PF04762 IKI3:  IKI3 family;  I  96.0    0.46   1E-05   66.2  22.4  164   97-286   259-457 (928)
280 COG2706 3-carboxymuconate cycl  95.9    0.18 3.9E-06   62.3  16.2  128 2221-2356  192-325 (346)
281 COG5170 CDC55 Serine/threonine  95.9   0.011 2.4E-07   71.0   5.8  140 2217-2366  170-322 (460)
282 KOG1354 Serine/threonine prote  95.9   0.021 4.5E-07   69.6   8.1  136 2222-2368  216-374 (433)
283 KOG4190 Uncharacterized conser  95.9  0.0057 1.2E-07   76.7   3.5   79 2268-2352  732-812 (1034)
284 KOG4532 WD40-like repeat conta  95.6    0.18 3.8E-06   60.5  13.7  128 2234-2378  131-262 (344)
285 KOG2321 WD40 repeat protein [G  95.5    0.09 1.9E-06   67.5  12.0  116 2223-2352  137-258 (703)
286 COG4946 Uncharacterized protei  95.5    0.24 5.2E-06   62.7  15.1  139 2221-2380  361-502 (668)
287 PF11768 DUF3312:  Protein of u  95.3   0.049 1.1E-06   70.4   8.9   71 2221-2303  261-331 (545)
288 KOG1334 WD40 repeat protein [G  95.3   0.026 5.6E-07   71.2   6.1  106 2269-2382  140-248 (559)
289 PF08450 SGL:  SMP-30/Gluconola  95.2    0.66 1.4E-05   54.1  17.2  141 2220-2379   86-238 (246)
290 KOG4714 Nucleoporin [Nuclear s  95.2   0.014 3.1E-07   69.1   3.4   73 2221-2302  181-255 (319)
291 KOG4532 WD40-like repeat conta  95.1    0.16 3.5E-06   60.8  11.4  113 2221-2351  160-281 (344)
292 KOG2066 Vacuolar assembly/sort  95.1    0.14 3.1E-06   67.9  12.0  112 2228-2363   80-196 (846)
293 smart00320 WD40 WD40 repeats.   94.9   0.054 1.2E-06   41.5   5.0   38 2309-2350    3-40  (40)
294 TIGR02658 TTQ_MADH_Hv methylam  94.4    0.86 1.9E-05   57.3  16.2  102 2241-2363   27-145 (352)
295 COG4946 Uncharacterized protei  94.3    0.86 1.9E-05   58.0  15.5  103 2267-2381  355-458 (668)
296 KOG1920 IkappaB kinase complex  94.0     3.6 7.8E-05   57.6  21.6   92 1315-1410  943-1038(1265)
297 KOG2041 WD40 repeat protein [G  93.9    0.36 7.8E-06   63.2  11.6  102   54-166    27-136 (1189)
298 COG0823 TolB Periplasmic compo  93.8    0.23   5E-06   63.6  10.0  143 2220-2383  193-342 (425)
299 PF07433 DUF1513:  Protein of u  93.6     1.5 3.2E-05   54.3  15.7  148 2223-2384  102-274 (305)
300 PF02897 Peptidase_S9_N:  Proly  93.6     2.4 5.1E-05   53.4  18.1  143 2220-2377  124-287 (414)
301 PF08450 SGL:  SMP-30/Gluconola  93.1     2.4 5.3E-05   49.5  16.1  137 2224-2381    4-148 (246)
302 KOG1409 Uncharacterized conser  93.0       1 2.2E-05   55.8  13.0  158 2200-2373   43-247 (404)
303 KOG1920 IkappaB kinase complex  93.0     1.9 4.2E-05   60.0  16.5  117 1258-1383  948-1067(1265)
304 COG5354 Uncharacterized protei  92.9    0.32   7E-06   62.2   8.9  137 2218-2380   31-187 (561)
305 KOG2314 Translation initiation  92.6    0.52 1.1E-05   60.8  10.1  106 2223-2351  214-333 (698)
306 PF12657 TFIIIC_delta:  Transcr  92.4     1.3 2.8E-05   50.1  12.1   99   38-143     4-135 (173)
307 KOG2041 WD40 repeat protein [G  92.3    0.62 1.3E-05   61.2  10.3  122 2217-2347   12-140 (1189)
308 TIGR02658 TTQ_MADH_Hv methylam  92.3     2.6 5.7E-05   53.2  15.6  121 2226-2362  200-338 (352)
309 PF14783 BBS2_Mid:  Ciliary BBS  92.2       3 6.4E-05   45.1  13.6   65 2222-2300    2-70  (111)
310 KOG1645 RING-finger-containing  92.0    0.25 5.4E-06   61.8   6.3   99 2268-2376  190-291 (463)
311 KOG1645 RING-finger-containing  91.9    0.56 1.2E-05   58.9   9.0  111 2222-2352  196-315 (463)
312 KOG1912 WD40 repeat protein [G  91.6       1 2.2E-05   60.1  11.0  128 2223-2372   19-161 (1062)
313 KOG3617 WD40 and TPR repeat-co  91.4    0.35 7.6E-06   64.3   6.8  107 2225-2352   21-131 (1416)
314 KOG4640 Anaphase-promoting com  91.4    0.58 1.3E-05   61.3   8.7   75 2220-2304   21-95  (665)
315 PRK02888 nitrous-oxide reducta  90.9     1.8 3.8E-05   57.9  12.5  143 2228-2386  285-451 (635)
316 PF15492 Nbas_N:  Neuroblastoma  90.8      18 0.00039   44.6  19.7  213   29-285    34-259 (282)
317 PF07433 DUF1513:  Protein of u  90.8     1.7 3.7E-05   53.7  11.6  143 2223-2379    8-175 (305)
318 KOG2695 WD40 repeat protein [G  90.4     0.4 8.7E-06   59.2   5.8  118 2235-2370  228-348 (425)
319 KOG1832 HIV-1 Vpr-binding prot  90.3    0.33 7.1E-06   64.8   5.2  105 2270-2386 1100-1205(1516)
320 COG5354 Uncharacterized protei  89.7     3.1 6.7E-05   53.9  12.7  136 2224-2382  227-375 (561)
321 TIGR03300 assembly_YfgL outer   89.6     2.3 4.9E-05   52.8  11.5  113 2231-2370  241-354 (377)
322 PF08553 VID27:  VID27 cytoplas  88.9     2.3   5E-05   58.3  11.6  129 2236-2386  499-638 (794)
323 PF00930 DPPIV_N:  Dipeptidyl p  88.4    0.82 1.8E-05   56.7   6.6  105 2228-2351    1-130 (353)
324 KOG1916 Nuclear protein, conta  88.4     0.3 6.4E-06   65.5   2.8  133 2222-2375  183-342 (1283)
325 PF12657 TFIIIC_delta:  Transcr  87.8     3.9 8.5E-05   46.4  10.9   82   98-183     8-134 (173)
326 COG5170 CDC55 Serine/threonine  87.6     2.1 4.5E-05   52.6   8.9  127 2221-2352   28-201 (460)
327 PRK13616 lipoprotein LpqB; Pro  87.3     2.5 5.4E-05   56.6  10.4  102 2221-2348  351-472 (591)
328 KOG3617 WD40 and TPR repeat-co  87.0    0.78 1.7E-05   61.3   5.3   81 2212-2302   51-132 (1416)
329 PF10647 Gmad1:  Lipoprotein Lp  86.5     6.8 0.00015   47.1  12.5  113 2222-2351   26-143 (253)
330 PRK13616 lipoprotein LpqB; Pro  86.4       4 8.7E-05   54.7  11.5  144 2223-2376  400-550 (591)
331 TIGR03300 assembly_YfgL outer   86.0     4.3 9.2E-05   50.4  10.9   98 2230-2349  278-376 (377)
332 PF13360 PQQ_2:  PQQ-like domai  85.0     8.9 0.00019   43.8  12.0  141 2199-2366    8-152 (238)
333 KOG1832 HIV-1 Vpr-binding prot  84.9     0.7 1.5E-05   61.9   3.5  135 2223-2381 1105-1245(1516)
334 KOG2444 WD40 repeat protein [G  84.4     2.4 5.1E-05   50.6   7.1  105 2232-2351   71-176 (238)
335 PF02897 Peptidase_S9_N:  Proly  82.9     7.1 0.00015   49.2  11.0  102 2273-2382  125-242 (414)
336 KOG3621 WD40 repeat-containing  82.9     8.8 0.00019   51.6  11.9  140 2221-2376   35-180 (726)
337 COG0823 TolB Periplasmic compo  82.7     6.8 0.00015   50.8  10.8  139   42-207   196-345 (425)
338 PF13360 PQQ_2:  PQQ-like domai  82.5       7 0.00015   44.6   9.9  102 2239-2362    1-102 (238)
339 COG3391 Uncharacterized conser  82.2      27 0.00058   44.5  15.7  140 2223-2382  119-268 (381)
340 PRK02888 nitrous-oxide reducta  81.0      11 0.00023   50.9  11.9   56 2292-2351  295-350 (635)
341 PF12234 Rav1p_C:  RAVE protein  80.5     9.5 0.00021   51.5  11.3   25 1386-1410  465-490 (631)
342 PRK10115 protease 2; Provision  80.2      35 0.00076   46.9  16.7  117 2220-2351  127-254 (686)
343 KOG1275 PAB-dependent poly(A)   80.2     5.2 0.00011   54.8   8.6  102 2230-2351  146-253 (1118)
344 KOG1275 PAB-dependent poly(A)   79.9     6.6 0.00014   53.8   9.4  104 2227-2351  183-295 (1118)
345 KOG2066 Vacuolar assembly/sort  78.9      12 0.00025   51.1  11.1   98 2223-2350   43-144 (846)
346 KOG2395 Protein involved in va  78.8     8.8 0.00019   50.3   9.7  135 2230-2386  344-491 (644)
347 PF07995 GSDH:  Glucose / Sorbo  78.1      15 0.00032   46.0  11.3  111 2223-2339    5-133 (331)
348 KOG2079 Vacuolar assembly/sort  77.6     5.4 0.00012   55.4   7.8   72 2220-2300  131-202 (1206)
349 PF12894 Apc4_WD40:  Anaphase-p  77.2     4.4 9.6E-05   37.6   4.9   33 2221-2254   13-45  (47)
350 KOG2114 Vacuolar assembly/sort  76.3      26 0.00056   48.4  13.2  111 2226-2350   30-153 (933)
351 PF10647 Gmad1:  Lipoprotein Lp  76.2      32  0.0007   41.5  13.1  115 2223-2348   69-192 (253)
352 PF14870 PSII_BNR:  Photosynthe  76.1      24 0.00052   44.1  12.2  105 2221-2338  146-251 (302)
353 PF10168 Nup88:  Nuclear pore c  75.7     9.7 0.00021   52.3   9.5   88   36-126    82-179 (717)
354 TIGR02604 Piru_Ver_Nterm putat  75.0      34 0.00074   43.2  13.4  148 2223-2384   17-201 (367)
355 KOG2444 WD40 repeat protein [G  74.8     5.5 0.00012   47.7   6.1   68 2225-2302  108-178 (238)
356 KOG2114 Vacuolar assembly/sort  74.3      41 0.00089   46.6  14.2  132 2221-2372  127-262 (933)
357 PF08553 VID27:  VID27 cytoplas  73.9      27 0.00058   48.6  12.9  104 2234-2355  545-650 (794)
358 PLN00033 photosystem II stabil  73.9      70  0.0015   41.6  15.9  144   44-207   244-390 (398)
359 KOG0882 Cyclophilin-related pe  72.4     7.2 0.00016   50.1   6.6  144 2227-2384   16-162 (558)
360 PF12894 Apc4_WD40:  Anaphase-p  72.2     7.5 0.00016   36.1   5.0   30 2272-2301   12-41  (47)
361 PF14783 BBS2_Mid:  Ciliary BBS  71.5      59  0.0013   35.6  12.2   99   97-210     2-107 (111)
362 PF11715 Nup160:  Nucleoporin N  70.6      14  0.0003   48.8   9.0   36 2223-2258  218-257 (547)
363 COG3391 Uncharacterized conser  70.4      72  0.0016   40.8  14.8  136 2223-2382   77-222 (381)
364 PF04053 Coatomer_WDAD:  Coatom  68.8     9.2  0.0002   49.8   6.7   86 1244-1362  356-441 (443)
365 PF06977 SdiA-regulated:  SdiA-  67.6      60  0.0013   39.7  12.6  184 2186-2381   15-236 (248)
366 KOG1008 Uncharacterized conser  66.9     2.7 5.8E-05   55.6   1.4  112 2223-2351  158-274 (783)
367 KOG3621 WD40 repeat-containing  66.7      12 0.00025   50.5   7.0  108 2222-2336   79-186 (726)
368 KOG1008 Uncharacterized conser  66.2     2.1 4.6E-05   56.5   0.3  139 2223-2378  106-255 (783)
369 KOG4640 Anaphase-promoting com  65.2      19  0.0004   48.3   8.3   78 2272-2361   21-99  (665)
370 PF00930 DPPIV_N:  Dipeptidyl p  65.1      50  0.0011   41.4  11.8  155 2221-2386  185-347 (353)
371 COG3386 Gluconolactonase [Carb  61.1 1.4E+02  0.0029   37.7  14.4  135 2223-2374  114-262 (307)
372 PF08596 Lgl_C:  Lethal giant l  60.4 1.1E+02  0.0024   39.8  13.7  147 2219-2375    1-201 (395)
373 PF04053 Coatomer_WDAD:  Coatom  59.1      51  0.0011   43.3  10.7   99 2224-2351   73-172 (443)
374 smart00299 CLH Clathrin heavy   58.3      22 0.00047   38.4   6.2   60 1293-1361   57-121 (140)
375 TIGR02604 Piru_Ver_Nterm putat  58.2      80  0.0017   40.0  12.0  101 2223-2336   75-200 (367)
376 COG3490 Uncharacterized protei  58.0      87  0.0019   39.3  11.5  102 2223-2337   71-179 (366)
377 PF14870 PSII_BNR:  Photosynthe  56.7 1.3E+02  0.0029   37.8  13.2  105   95-207   187-295 (302)
378 KOG0882 Cyclophilin-related pe  56.2      39 0.00085   43.9   8.6  117 2233-2363  114-240 (558)
379 PRK11138 outer membrane biogen  52.7      92   0.002   39.5  11.3  105 2231-2363  256-362 (394)
380 PF03178 CPSF_A:  CPSF A subuni  52.5      98  0.0021   38.2  11.2  112 2221-2352   90-202 (321)
381 PF10313 DUF2415:  Uncharacteri  52.2      29 0.00064   32.2   4.9   30 2273-2302    2-34  (43)
382 PF10168 Nup88:  Nuclear pore c  51.8      92   0.002   43.4  11.7   85  191-286    87-180 (717)
383 PF15390 DUF4613:  Domain of un  51.6 2.4E+02  0.0051   38.6  14.5  130  141-312    52-200 (671)
384 PF00780 CNH:  CNH domain;  Int  51.5 2.3E+02  0.0051   33.7  13.8  128 2229-2375    5-147 (275)
385 PF07569 Hira:  TUP1-like enhan  51.1      63  0.0014   38.6   8.9   73 2225-2302   16-96  (219)
386 PRK13684 Ycf48-like protein; P  49.6 1.9E+02  0.0042   36.4  13.2  110 2221-2347  174-283 (334)
387 PF04841 Vps16_N:  Vps16, N-ter  49.4 2.8E+02  0.0061   36.2  14.9  131 2226-2387  185-316 (410)
388 TIGR03606 non_repeat_PQQ dehyd  47.7 2.2E+02  0.0048   37.9  13.7  110 2223-2338   33-164 (454)
389 PRK11138 outer membrane biogen  47.3 1.2E+02  0.0026   38.6  11.1   99 2230-2350  293-392 (394)
390 PF06977 SdiA-regulated:  SdiA-  47.2 2.8E+02   0.006   34.2  13.5  116 2222-2351   24-146 (248)
391 PF15390 DUF4613:  Domain of un  47.0      61  0.0013   43.7   8.4   98  802-917    80-184 (671)
392 KOG4460 Nuclear pore complex,   46.5 1.4E+02  0.0031   40.0  11.3   85  190-285   105-198 (741)
393 PF13449 Phytase-like:  Esteras  46.3 1.8E+02   0.004   36.5  12.3  125 2224-2351   89-248 (326)
394 PRK11447 cellulose synthase su  45.2 7.2E+02   0.016   36.7  19.4   63 1463-1556  575-637 (1157)
395 PF14655 RAB3GAP2_N:  Rab3 GTPa  43.5      83  0.0018   41.2   8.9   77 2221-2303  309-400 (415)
396 PLN00033 photosystem II stabil  43.4 4.5E+02  0.0098   34.5  15.3  133 2223-2377  242-381 (398)
397 PF12110 Nup96:  Nuclear protei  43.4      32  0.0007   42.5   5.1   48 1325-1376    2-49  (290)
398 PF14761 HPS3_N:  Hermansky-Pud  43.2 5.1E+02   0.011   31.7  14.4  126  110-285    29-163 (215)
399 KOG4460 Nuclear pore complex,   42.4      61  0.0013   43.0   7.3   82   41-126   106-198 (741)
400 PF12931 Sec16_C:  Sec23-bindin  42.2      43 0.00093   41.3   6.0   75 1332-1411    5-85  (284)
401 PF05935 Arylsulfotrans:  Aryls  41.4 2.6E+02  0.0056   37.2  13.0  124 2225-2367  153-314 (477)
402 PF07569 Hira:  TUP1-like enhan  41.3      89  0.0019   37.4   8.2   69 2277-2351   16-94  (219)
403 KOG4441 Proteins containing BT  41.2 2.4E+02  0.0051   38.5  12.9  136 2197-2351  302-451 (571)
404 PF03178 CPSF_A:  CPSF A subuni  39.6 8.3E+02   0.018   30.3  21.0   98   96-207    90-192 (321)
405 KOG4649 PQQ (pyrrolo-quinoline  37.4 2.2E+02  0.0049   35.5  10.5   71 2230-2316   62-133 (354)
406 TIGR03118 PEPCTERM_chp_1 conse  35.9 4.1E+02  0.0088   34.1  12.6  124 2217-2351   22-169 (336)
407 PF14583 Pectate_lyase22:  Olig  34.1 4.2E+02   0.009   34.9  12.7  130 2198-2349  209-378 (386)
408 PF13449 Phytase-like:  Esteras  33.0 6.2E+02   0.013   31.9  13.9  156 2223-2382   23-230 (326)
409 PF08728 CRT10:  CRT10;  InterP  32.9 2.4E+02  0.0053   39.4  11.0  114 2229-2351  112-245 (717)
410 KOG4499 Ca2+-binding protein R  32.1 6.9E+02   0.015   31.2  13.1  137 2223-2375  112-262 (310)
411 KOG3616 Selective LIM binding   30.2      75  0.0016   43.3   5.5   62 2222-2298   17-80  (1636)
412 PF14655 RAB3GAP2_N:  Rab3 GTPa  30.1 2.9E+02  0.0064   36.4  10.7   32 2272-2303  308-339 (415)
413 PF13934 ELYS:  Nuclear pore co  29.7   3E+02  0.0066   33.2  10.1  160 1241-1415   24-202 (226)
414 KOG2395 Protein involved in va  27.3      87  0.0019   41.8   5.3   58 2233-2301  443-500 (644)
415 cd00870 PI3Ka_III Phosphoinosi  25.9   3E+02  0.0066   32.0   8.8  116 1276-1399   30-161 (166)
416 KOG2377 Uncharacterized conser  25.6 1.7E+02  0.0037   38.7   7.3   30 2272-2301   67-96  (657)
417 PF10313 DUF2415:  Uncharacteri  25.4 1.3E+02  0.0029   28.2   4.6   31 2221-2251    2-35  (43)
418 PF11715 Nup160:  Nucleoporin N  25.2   1E+02  0.0022   41.0   5.7   33 2272-2304  215-251 (547)
419 KOG4659 Uncharacterized conser  24.8 2.8E+02  0.0061   40.8   9.5   16  894-909   370-385 (1899)
420 KOG3616 Selective LIM binding   24.3   2E+02  0.0043   39.7   7.7  134 1319-1485 1102-1237(1636)
421 KOG1897 Damage-specific DNA bi  23.5 4.1E+02  0.0088   38.3  10.5  150 2221-2382  716-884 (1096)
422 PRK11447 cellulose synthase su  23.3 6.9E+02   0.015   36.9  13.5   77 1332-1409  583-661 (1157)
423 PRK10370 formate-dependent nit  23.2 5.3E+02   0.011   30.3  10.3   74 1336-1409   87-168 (198)
424 PF05787 DUF839:  Bacterial pro  22.7 7.2E+02   0.016   33.8  12.6   57 2068-2126  347-411 (524)
425 PRK10115 protease 2; Provision  22.6 4.4E+02  0.0095   36.8  10.9  101 2272-2383  127-239 (686)
426 PF07676 PD40:  WD40-like Beta   22.4 1.2E+02  0.0027   26.1   3.9   22  144-165     7-28  (39)
427 PF08728 CRT10:  CRT10;  InterP  21.4   2E+02  0.0044   40.1   7.3   74 2220-2300  164-245 (717)
428 TIGR02917 PEP_TPR_lipo putativ  21.2 8.2E+02   0.018   33.1  12.8   65 1463-1554  195-259 (899)
429 PF07676 PD40:  WD40-like Beta   21.1 2.2E+02  0.0047   24.6   5.1   30 2317-2349    7-38  (39)
430 PRK13615 lipoprotein LpqB; Pro  20.9   6E+02   0.013   34.9  11.3  114 2220-2351  334-448 (557)
431 PHA02713 hypothetical protein;  20.2 9.5E+02   0.021   32.8  13.0   85 2196-2293  320-409 (557)

No 1  
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=100.00  E-value=0  Score=3012.84  Aligned_cols=2154  Identities=24%  Similarity=0.321  Sum_probs=1801.2

Q ss_pred             ccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCC-CCeeEEEEcCCCCCC
Q 000080           31 EFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNS-LPVTSISWSPETPSI  109 (2389)
Q Consensus        31 ~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~-~dVk~VaWSPd~~~~  109 (2389)
                      -++|.||-+..+..+- ..+++++|+|||+|+.+||.-  +   +||++      |+||+..|+ ..|.+|+++-+   .
T Consensus         5 QvlpGa~n~g~~~y~~-gsi~~~pftay~sg~~vvIl~--n---~ferv------QiIp~~~~g~~~vsav~c~~~---t   69 (2439)
T KOG1064|consen    5 QVLPGAPNAGDNCYSV-GSIGDLPFTAYASGCDVVILT--N---DFERV------QIIPGAKHGNILVSAVDCSQQ---T   69 (2439)
T ss_pred             cccCCCCCCCCCCcee-ceECCeeEEEeecCCceEEEc--C---CceeE------EeccccCcCceEEEEEeeccc---c
Confidence            3567777666655544 356688999999999999998  6   99999      999997775 77999999999   9


Q ss_pred             CcEEEecCCeEEEEeeCC-CCCC----CCccceeeEEecccceEEEEeecCCCCeEEEEecceEEeec-------c----
Q 000080          110 GQLAAASENCIFVFAHDS-ASSK----GSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGMETVLWKK-------K----  173 (2389)
Q Consensus       110 GeIaASyDntIRVw~~d~-~~~k----gd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdDV~IW~~-------~----  173 (2389)
                      |.|||+|+|.|.||+|.. ...+    ..++|.+..+++|+++|-++.|+++|.|+++||+.+++|+.       .    
T Consensus        70 G~IA~sygn~v~I~eP~~i~s~k~n~~~~~~W~~t~qf~~~~~~~s~~w~~~~~rlltgs~~l~Lwq~~~~~~~~~~~~i  149 (2439)
T KOG1064|consen   70 GKIAASYGNVVSIFEPTNILSSKGNPHLAVQWVQTTQFFHDSTVVSLNWNFEGLRLLTGSDNLQLWQETINFSIEEPEEI  149 (2439)
T ss_pred             ceeeeccCCeeeecCCcchhhhcCCcceeeeEEeeecccccccceeeeeccccchhhhcCcceEEEeccCCccccccccc
Confidence            999999999999999863 1122    34579999999999999999999999999999999999973       1    


Q ss_pred             -------CCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccc-cccCCCCCCCceeEEEeeCCCccceeecccCCCC
Q 000080          174 -------NTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQ-LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQP  244 (2389)
Q Consensus       174 -------~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dik-f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qd  244 (2389)
                             -..|||+|+++..++  ++..+|||||. |||+|.+-. .++|-.+.      +-++.++..|.++|++||++
T Consensus       150 ~d~~l~~~~~We~iW~~k~~~~--v~~~~~SpDG~f~at~g~~dclaKvwy~~~------~~~~~~~~~f~~vyL~HP~~  221 (2439)
T KOG1064|consen  150 TDTVLPKRRDWELIWSCKTPSP--VYSSTISPDGEFFATIGKRDCLAKVWYKST------VSQSGGEESFSFVYLPHPRR  221 (2439)
T ss_pred             ccccccccccceEEEeccCCcc--eeEEEEcCCcceEEeccccCcchhhhcccc------cccccCccceeeEeccCCcc
Confidence                   137999999987766  88889999999 888888443 33331000      11235667789999999999


Q ss_pred             eeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccccccccC------CCCccceeEEEEEEEeeccc
Q 000080          245 VSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDTN------DHKTIRRSFCVGAIIEINQA  318 (2389)
Q Consensus       245 Vn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~~------d~~~~~~sF~vaA~I~~~~~  318 (2389)
                      |++++||.+++||||+    +++|+|+|||.||++|||+|++.++.++.++...      -|.++.+|||+||.||  + 
T Consensus       222 Vs~~~WRktskymp~g----sv~nvL~T~C~D~v~RIW~et~~p~~~l~~~~~~~~~~~~~~~sa~~~f~~aadin--~-  294 (2439)
T KOG1064|consen  222 VSGFQWRKTSKYMPRG----SVSNVLMTCCLDNVCRIWCETDLPKDCLVMLTGFDHKMKSFHVSALCHFHIAADIN--P-  294 (2439)
T ss_pred             cccceeccccccCCcc----chhhhHHhhhccCceEEEEEeccCCCeEeeeccccccccccccCCCcceEEEeecC--c-
Confidence            9999999999999999    7999999999999999999999998888666553      3567899999999999  7 


Q ss_pred             ccCCCCCCeEEEeecccccee--eccCCccceecccccccccceeeeeeEeecCCccceeEEEeeeccCCCCCcCeEEEe
Q 000080          319 LNGALGMDIVITWAKEIRCMF--ETGEGANHFISTGVYEHGGTGKCEWLVGYGPGSLVTLWAIHCLDDISPLRFPRVTLW  396 (2389)
Q Consensus       319 ~~~~l~~~~~v~W~~~~~~vf--~~~~e~~~~~~s~~~~~~~v~~~eW~~~~~PGs~l~~W~v~~LDd~~~~R~prVt~~  396 (2389)
                      .||    +|.| |+||||+||  -+-|..++.++.++++...|+.|||+.|..||..+++|||||||||+||||||||||
T Consensus       295 ~tD----~F~v-Wlnnke~~F~~~t~e~se~~~s~d~~~e~~vg~~~r~~G~ss~~~l~~W~V~~LDd~~pfRq~~vS~~  369 (2439)
T KOG1064|consen  295 ATD----PFVV-WLNNKELHFLTLTHENSEQDFSMDDEDEEIVGDGERLGGLSSGNPLNNWHVEWLDDYSPFRQPQVSFS  369 (2439)
T ss_pred             ccC----ceeE-EEecccceeEEEeecCcccccccccccccccccccccccccCCCcccchhhhhccccCccccceeeec
Confidence            555    5666 999999999  444444556788888888899999999999999999999999999999999999999


Q ss_pred             eeccccccCCCCCCCCCCcCccccceeEEe-----------ccccCCCCcccccccccccCcceeehhcccCCCCccccc
Q 000080          397 KKQNLELEHPHNSGFSGFQGQSLLNKVVIS-----------RDCVSGLPTICSLVHLSHCNSLVWSLLHAQRSGDVEDVS  465 (2389)
Q Consensus       397 ~r~~~~~~~~~~a~f~~~~da~~l~~~vi~-----------r~~~~g~p~~cs~~~l~~~N~~~~~~~h~~~sln~~~~s  465 (2389)
                      +|+|.        +||+ +|+++|++.+.+           ++...-+..+|+++...+ |+++|+++|.||++|  +++
T Consensus       370 srip~--------a~p~-~da~SLss~~~~~~~~~~~k~aiq~~~~~~~s~~ss~~Hs~-~tv~~is~H~ngsln--~~~  437 (2439)
T KOG1064|consen  370 SRIPS--------AFPT-GDAMSLSSATMLNDCTPLYKDAIQPDNLYPGSILSSSYHSK-PTVMMISKHTNGSLN--SVS  437 (2439)
T ss_pred             ccccc--------cccc-cchhhhhhhhcccCCcccchhhhccCCcCCCccccccccCC-CceEEEEeecccccc--cee
Confidence            99999        9999 999999999887           222223335788777777 999999999999999  889


Q ss_pred             cCCCC-ccceeeecccceeeeccccceEeEEeeeccccchhhhhcc-CCC------ccEEEEEecccccccCCCCCCCCc
Q 000080          466 SDKSS-TGQILSCSASRILSIEGHTGKILQVAVHPCVSEFELAVSL-DSN------GLLLFWSLSTISNCISDLPTLMPS  537 (2389)
Q Consensus       466 ~~~~s-f~~i~s~~~s~~~~~~GH~~~i~qv~~Hp~l~~l~Lt~S~-d~~------~~LilW~vspv~~~~~~~~~~~P~  537 (2389)
                      |++.+ |++++++  +|++|+|||||+|+||++||++ |++||+|+ +++      +|||+|+++||          || 
T Consensus       438 fs~~ssft~vls~--~h~~r~~GHrf~i~~la~hsvl-pllltTS~~~~~~~~~i~Se~ilwrv~~v----------gP-  503 (2439)
T KOG1064|consen  438 FSLKSSFTTVLSI--GHVSRFCGHRFHINDLACHSVL-PLLLTTSHHNSNDPIAICSELILWRVDPV----------GP-  503 (2439)
T ss_pred             cccccchhheeee--eeEEEeecCCcchhhhccCCCc-cceeeecccccCCccceeeeeeEeeccCC----------cc-
Confidence            99988 9999999  9999999999999999999999 88888887 434      89999999999          99 


Q ss_pred             cccccc---ccccccc--CCccceeeeccccccceEEEEeecCCeeEEEEeccccCCCCeEeeeeEEEeccCCCCCCCCC
Q 000080          538 WKLCGK---LRTRKSC--SNYTSLRWAPSLLDEDMVLLMGHVGGIDCFIVKISQTEVDDIVCHYVCTIPFTGHGHYEDGP  612 (2389)
Q Consensus       538 l~~~Gg---lar~~s~--~~ftsl~W~Psil~~~~~~fva~~gg~d~~l~~i~~~~~enit~~~~c~i~l~~~~~~~~~~  612 (2389)
                      +|+.||   ++|+++.  ++|++|+|+|++||++|...+ |.|+.+||++.-++...  +--|..|+|||+.......  
T Consensus       504 ls~~ggVselar~Ns~~~s~fs~v~w~ptllps~~lg~~-~ns~sacFvA~dg~~~r--~yqavida~~ll~e~s~~e--  578 (2439)
T KOG1064|consen  504 LSFNGGVSELARINSLHISAFSNVAWLPTLLPSYCLGTY-CNSPSACFVASDGGNLR--KYQAVIDAIPLLVELSLPE--  578 (2439)
T ss_pred             eeeccCcchhhhccchhhhhhceeeecccccccceeeee-ccCCcceeEEecCCcch--hhhhhhhcchhhhcCCchh--
Confidence            999999   9999998  999999999999999998777 88888888888776654  5778899999987644332  


Q ss_pred             ceeeeecCCccCCcccccceEEEEEEeecccceeEEEEEEeeecCCcccccCC-CCCCccccccCCcccccccceeeeee
Q 000080          613 ANIFSVPLPSCNDKTVMYNKFMLLGVWLKGLESLSWEITFHSFDLSESCCGCI-DDNNTVKCSMCKFETTFCGKKYFIGV  691 (2389)
Q Consensus       613 ~~ih~~p~~~~~~~tf~~n~f~lv~v~~~~f~~l~W~v~l~s~~~~~~~~~c~-~~~~~~~~~~~~~~~s~a~k~~~l~~  691 (2389)
                      .++++-|.-.+|+++|+-+++.++-||+++|...+|+.+||.|+....+|+|+ -+.+......+-|+..|.++.++..+
T Consensus       579 ~S~~i~~~~n~vsqqsta~Pgcil~l~~i~~~~~~ns~~lhvFq~~~i~~~~~~~~~~~~~~~~~~Fee~F~~v~ie~~~  658 (2439)
T KOG1064|consen  579 TSKFIGEVFNIVSQQSTARPGCILELDPIEKHNGSNSQLLHVFQEGFITADEHFMDSDSGGSPNPLFEEKFYGVIIEKKI  658 (2439)
T ss_pred             HhhHhhhhhccccccccCCCcEEEeccccccccccchhhhhhhccCceeecccccccccccCCCccccccceeeeeeeec
Confidence            78888899999999999999999999999999999999999999999999999 77777777778899999999888888


Q ss_pred             c----cccCcCCCCCCcccccEEEEeecCCCcCCCccccCCCCCCCCCCCeEEEEeecCCcEEEEEEEeCCCCCCceeee
Q 000080          692 N----PCSSQFPEPHTRNWVTSFAVVCPNNLVPMQQKLVYDNDPCSKIPPYTMATGYSDGSLRLWRSELGGSSTSCMPWE  767 (2389)
Q Consensus       692 ~----~cs~~~P~~~l~~~v~s~~~v~p~~~~~~~~~l~s~~~~~~~~~pYliaT~CSDG~VRfWkc~v~~~~~~~y~We  767 (2389)
                      +    +|+|++|   +||+| +++++.|++     |||++++.||+  +||+|||+|+||+||||||++.++++....  
T Consensus       659 d~ls~v~~q~l~---lpE~v-~i~~~~Psa-----ghlSssS~ypa--apYli~t~~sDg~vRfWrc~~~~d~~~~~s--  725 (2439)
T KOG1064|consen  659 DSLSSVYTQELD---LPEGV-DIIVISPSA-----GHLSSSSNYPA--APYLIATICSDGLVRFWRCRVQGDDTAPNS--  725 (2439)
T ss_pred             cccceeccCCCC---cccce-eEEEecCcc-----ccccccccCcC--cceEEEEeccCCceeeeeeeeccCCCCccc--
Confidence            7    6778885   99999 899999998     99999999999  999999999999999999999876544332  


Q ss_pred             eeeeeecCCCCceEEEeecCCCeEEEEccCCC-CCCccEEEEEeeccccCcceeEeeceeccCC-----------ceEEE
Q 000080          768 LVGMLVAHQGPVSAISLTDGGRKIATVSAASH-SNAVSNVRIWESVCVTELGSFVLEDTLSFDT-----------NIVAV  835 (2389)
Q Consensus       768 ~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~-~~~~s~vsIWD~~~~sgGGswvLE~ti~ld~-----------~IVdL  835 (2389)
                      ||+|+.+      +|+|+|+||+||+|+++++ +....+|+|+|| ++++|+.|++|++|+++.           |||||
T Consensus       726 ~W~l~~~------~Is~a~tgr~A~ay~~~~s~s~~~~~vai~ec-es~ggS~W~le~ti~~~~~~~e~~~~n~~~lv~L  798 (2439)
T KOG1064|consen  726 EWPLVSE------EISCAQTGRLACAYKKGSSTSIFALKVAIFEC-ESRGGSIWVLEQTIHSDEEHLESIFHNDKHLVDL  798 (2439)
T ss_pred             hhHHHHh------hhhhcccCceeEEEecCCCcchheeEEEEEEe-cCccceEEEeehhhhhhhhhhhhhccccccceee
Confidence            6667666      8999999999999999887 567789999997 555555599999999863           89999


Q ss_pred             EeEEccCCcEEEEEeecceEEEEEeccCCccccccccc--------------ccccccceeecc----CCCCC-cccccc
Q 000080          836 NWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKN--------------SLKMQNWFCLAF----SPTFA-AHDFTW  896 (2389)
Q Consensus       836 DWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~--------------ll~~~~w~~Id~----~~T~h-IgDssW  896 (2389)
                      |||||||||||||||||++|+||+|+|++|++...+.|              ..-.+.|.++|.    .+||| |+|++|
T Consensus       799 DW~Stedg~hILtVg~g~~v~lY~qlr~~~~~~t~~~~~~~s~~~P~~~~~~~~~~~~W~~lR~idl~~gtp~lp~~~sW  878 (2439)
T KOG1064|consen  799 DWTSTEDGQHILTVGFGSKVLLYGQLRQDYTNQTFAAMSSESQIRPLFRSTKSLSASSWVLLRSIDLLSGTPPLPVDLSW  878 (2439)
T ss_pred             eeeecCCCcEEEEEeccceEEEEeecccchhhhhhhhhcchhhcccchhhhccccccceeeeeEEeeecCCCCCcccccc
Confidence            99999999999999999999999999999998652211              111237777763    59999 999999


Q ss_pred             ccCceEEEEecCeeEEeeccchhhccccccccCCCccccccccccCCCCCCceeeecccccccCccC-CCCCcccCCCcc
Q 000080          897 GRRAIAIVVHQSYLSIYSQFLFLIDKKHQAKCNSNVFIDNFCCHKSGINENIVSTIFTVCDSESSAG-DQRGDYESAPSV  975 (2389)
Q Consensus       897 VRDGILVVGmgnEMhVYSQWl~~~~~k~q~~~~~~~~~~~~~~~~s~~~~~lv~~i~~~~ds~~~a~-~ql~~~~s~~~~  975 (2389)
                      |||||||||||||||||+||++....      ..+........+     .++.   +..+.+ .+.. .+......+   
T Consensus       879 vrdGilVv~md~em~vy~qw~~~~~~------~~D~~l~s~~~d-----~s~~---~~~~~~-~~~~~~~~S~~~~~---  940 (2439)
T KOG1064|consen  879 VRDGILVVAMDNEMHVYNQWKPSLVQ------GRDSSLLSTTND-----ISLL---DSTSTS-SGCLPSKKSRVLGD---  940 (2439)
T ss_pred             eecceEEEeecCcceehhcccccccc------ccCcccccCccc-----hHHH---Hhhccc-cccccCcccccccc---
Confidence            99999999999999999999983221      111111000000     1110   000000 0000 011111111   


Q ss_pred             cccccccccccccccccCCcc-ccccCHHHHHHHHcCCCCCcchHHHHHHHHcCCchhHHHHHHHHHHhccCCCCCcccc
Q 000080          976 NIDMKNDHLVASDQLKCGGAI-LGSWSMLEIAEKLRGSLPVYHPKALFLNIYSGNWKRAYVSVRHLVENLPSNYPSEKRY 1054 (2389)
Q Consensus       976 ~~~~~s~s~i~~~~~~~~~~~-~~~~~Lfe~~~~LnGpLPvYHPqfLiQ~L~~GK~~rVK~IL~~Lvk~L~~~~~~~~~~ 1054 (2389)
                       ..+.+...++...  +.+.. +.+.++||++++|+|+|||||||||+|+|++||++|||+||.||++||+....-.+.+
T Consensus       941 -~s~~~~~~~~~a~--~~~t~~~~~~glfe~a~vl~g~LPqYHP~qLl~ll~~gk~rrakAIL~hL~~cl~~~~~~~~~~ 1017 (2439)
T KOG1064|consen  941 -TSVANMSCIGTAY--GSPTVDIDDMGLFEAAHVLSGILPQYHPQQLLELLDAGKVRRAKAILLHLVLCLKGSVTVHKDL 1017 (2439)
T ss_pred             -cchhhcccccccc--CCcccccccccHHHHHHhhCCCCcccCHHHHHHHHHcCcHHHHHHHHHHHHHHhcccccccccc
Confidence             1112222222211  33444 4789999999999999999999999999999999999999999999998832211111


Q ss_pred             c----------------ccCCCCCCcccchhhhhcc-cccCCCCCCCccccCCCcccchhhhhhccccccccCCCCCCCc
Q 000080         1055 C----------------YTKSSHIVPQILLSTYFEG-LLSKGSTDNGFQWSGLNTFSTSLQFRQFAYNMDLDASNSSSST 1117 (2389)
Q Consensus      1055 ~----------------~~e~~~~~p~i~l~~~~~~-~~s~~~~~~~~~~~~~~~~~~~~~f~~~~~~~d~d~~~~~~~~ 1117 (2389)
                      +                +++++++ |+.|++.+.+. .++.+...++       ...|++.|+     +....+ ..+++
T Consensus      1018 ~~~st~~~~~d~~~~~~~~ei~Si-pplPl~~l~~ad~Ds~~~s~e~-------s~gyd~lF~-----~~~~~~-~~~e~ 1083 (2439)
T KOG1064|consen 1018 ASDSTSVLCQDELISKDTTEIDSL-PPLPLYALLAADRDSPYQSVEK-------SSGYDELFN-----DELSKT-ILLET 1083 (2439)
T ss_pred             ccccccccchhhhccccchhhccC-CCCcHHHhhccccCCcceeccc-------ccccchhhh-----cccccc-ccccc
Confidence            1                1355544 55555444432 2211111000       011344552     222222 22456


Q ss_pred             hhhhhHHHHhhhccccccCCCHHHHHHHHHHHHHHHHhhccccccccccCCccccchhhHHHHHHHHHhhhcCccccccc
Q 000080         1118 KSELSGFVELLQNVYELAGVTDAEKMEILAVVDLLNEFDNKHSASVYENLDEPGQRFWVELRFQLLCFFRRFGKLVSAEE 1197 (2389)
Q Consensus      1118 ~~~~s~l~E~L~k~~sLPgLT~~EQm~Llalidtv~~i~k~~~~~~~~sLDenGlRFLl~~k~~ql~~lr~~~~~~~~~~ 1197 (2389)
                      +++.+-|++.|.++++||||||+|||+|+||||||+++...++.   ++|||||+|||++||+++++..+..++.++.+.
T Consensus      1084 d~~~s~FLt~lLths~lpgLSR~eQm~LlAlaDtv~~~st~~~~---~tLDecGlRfllamr~~~~ll~~lp~~raql~~ 1160 (2439)
T KOG1064|consen 1084 DEEFSYFLTELLTHSSLPGLSRLEQMHLLALADTVAETSTDHSE---ETLDECGLRFLLALRLHTLLLTSLPGYRAQLLH 1160 (2439)
T ss_pred             hhhhhHHHHHHHhhccCCCccHHHHHHHHHHHHHHHHhcccccc---ccccccchhHHHHHHHHHHHHhhchhhhhhhhh
Confidence            67777888777777899999999999999999999999877543   679999999999999987655444444556666


Q ss_pred             cccccccchhhhcccCHHHHHhhc---CCCCCCHHHHHHcCcEEEEeChHHHHHHHHHHHHHHHhccCCcchhHHHHHHh
Q 000080         1198 LAVDSRLIAWAFHSECQETLFGSI---LPNEPTWPEMRALGVGFWYTDVTQLRTRMEKLARLQYLKKKDPKDCALLYIAL 1274 (2389)
Q Consensus      1198 ~~Ls~r~i~WA~HSesqe~LL~~v---~~~~~sW~~~r~~Gv~~Wl~~~~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL 1274 (2389)
                      .+|++++|+||||||+||+||+.+   .+++++|++||++|||||++|..+||++||||||++|+++|||+|||||||||
T Consensus      1161 ~gl~ts~iaWAFHSe~eEeLlNl~psl~r~~~sW~elR~~gig~WlkN~~~Lr~ciEKlAK~af~kn~dP~DaALfYLAL 1240 (2439)
T KOG1064|consen 1161 QGLSTSHIAWAFHSENEEELLNLLPSLHRGDPSWNELREYGIGWWLKNEQTLRKCIEKLAKAAFQKKRDPLDAALFYLAL 1240 (2439)
T ss_pred             cCCchhheeeecccccHHHHHhhcccccCCCccHHHHHhhCchhhhccHHHHHHHHHHHHHHHHHhcCChhhhhHHHHHH
Confidence            799999999999999999999854   57899999999999999999999999999999999999999999999999999


Q ss_pred             cchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhh
Q 000080         1275 NRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQL 1354 (2389)
Q Consensus      1275 ~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qL 1354 (2389)
                      |||+||+||||++++||+++|++||+|||++||||+||+||||+||||||||+|||||||||+++|||+||++||+|+||
T Consensus      1241 kKk~Vl~gLfr~~~~hed~kmv~FfsnnF~eerWrkAAlKNAFvLLgKhRfe~AaaFFLLagslkDAI~VC~kkl~DiQL 1320 (2439)
T KOG1064|consen 1241 KKKQVLWGLFRLAKDHEDTKMVVFFSNNFTEERWRKAALKNAFVLLGKHRFEHAAAFFLLAGSLKDAINVCCKKLNDIQL 1320 (2439)
T ss_pred             HHHHHHHHHHHHhhccccchHHHHhhccccHHHHHHHHHhhHHHHhhhHHHHHHHHHHhhcchHHHHHHHHHHhhhhhhh
Confidence            99999999999999999999999999999999999999999999999999999999999999999999999999999999


Q ss_pred             hhhhhhhhccCCChhhHhhHhhhccccccccCChhHHHHHHHHhCChhHHHHHHhcCccccccccccccCCCccC-----
Q 000080         1355 ALVICRLVEKHGGPLERNLVTKFILPSSIERGDYWLTSLLEWELGNYSQSFLTMLGFQSTAVINNFALSSNSVAF----- 1429 (2389)
Q Consensus      1355 Ai~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~~~~~Av~~Ll~~p~~~~~~~s~l~s~~~~f----- 1429 (2389)
                      ||+||||||||+||++++||+++|||.+++++||||+||+||+||+|.+|++||++.++.+......-.+++..|     
T Consensus      1321 ALvI~RlYEgd~g~~~~~LL~~~vLp~~v~~~DpwLrSmayWiLkdy~rAl~tLl~~~~~end~~~~s~~~~~Vf~ny~y 1400 (2439)
T KOG1064|consen 1321 ALVICRLYEGDGGPTYKELLNKYVLPIAVQHNDPWLRSMAYWILKDYTRALLTLLGQLPRENDALYTSASNPEVFNNYSY 1400 (2439)
T ss_pred             hheeeeeecCCCchHHHHHHHHhhcccccccCCHHHHHHHHHHHHHHHHHHHHHhcCccccChhhhhcccCcchhhchhh
Confidence            999999999999999999999999999999999999999999999999999999987433222110002222222     


Q ss_pred             -CChHHHHHHHHh-hccccchhhhccch----hhhhHHHHHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCC
Q 000080         1430 -MDPSIGLYCLML-ANKNSMRNAIGEKN----AAILGRWAALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIG 1503 (2389)
Q Consensus      1430 -~DPaL~l~~~~L-~sk~~~r~~~g~~~----~~~~~r~~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~ 1503 (2389)
                       -+|-+++|+... +.+..++++.|..+    +...|||+|+++|++|+|||||+||||+|++......++.+.+++...
T Consensus      1401 lr~hplllr~~~~~~~~~~~~~~L~~~~~e~~~~~iErrl~l~tA~ah~r~GCpllALevLs~~p~~~~~s~d~s~~~~~ 1480 (2439)
T KOG1064|consen 1401 LRTHPLLLRRNLASAEKFSLKYALGGRSLEDIINLIERRLFLTTANAHCRCGCPLLALEVLSKWPKVIKGSKDTSEASKL 1480 (2439)
T ss_pred             hccCcHHHhhhhccccchhHHHHhhccchhhcccchheeeeeehhhHHHhcCCcHHHHHhhhcccccccCCcccchhhcc
Confidence             266666677776 66777888888777    457899999999999999999999999999999999999998988777


Q ss_pred             Ccccccc----cccCCCCCCCccccccccccccccccccccHHHHHHHHhhcCCCCCccCcCCCCccccchhhhhHHHHH
Q 000080         1504 HSHILPE----ILKPSAATGSSNWLLRDVALHLESCAKLDLSLQYFSKLIRDHPSWPDLGFGRASKCFMDFEIHQYEKLV 1579 (2389)
Q Consensus      1504 ~~~~~~~----~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1579 (2389)
                      +-+--++    ...+..+ +|.+|....|....+++...+.+.+..+..-+|-..+.           ++-++.+++| .
T Consensus      1481 ~~~d~q~~a~~~~~~~t~-~s~dw~~p~vs~~~d~~~~~w~~e~~ee~~~~e~~~~~-----------~~~p~~~~~k-~ 1547 (2439)
T KOG1064|consen 1481 QLDDRQSGASGEADSSTP-ISFDWSQPSVSDQDDSLELDWDEEQNEEEIDREADEPL-----------LNPPVRQCDK-F 1547 (2439)
T ss_pred             ccccccccccCCCccCCc-ccccccCCcccCCCCCcccCccccccchhhcccccccc-----------cCCcccccch-h
Confidence            7666666    6777766 99999999999999999999999999888877775444           7778889988 7


Q ss_pred             HHHHHHHHHHHHHHhhhcccChHHHHHHHHHhhccCCeeeeeeehhcccccCCCccccccCccCCcccccccchhhhhhh
Q 000080         1580 QNFQQKLYTALAFFEQRFSMDSSSLIAKILSLLCNNGLLFIGYDLLHGYICQGKSQEKSSDTVDGLSLYFCQHKPLLKAA 1659 (2389)
Q Consensus      1580 ~~~~~~~~~~~~~f~~~f~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1659 (2389)
                      -+++.|+.|+ ..|.|+|.+++...|.|..+.-.+.|....|..|...........+| ........+|....|.. |+.
T Consensus      1548 ~~~~s~~~t~-di~aq~~kfvA~l~ilm~eLsTlatG~e~dGg~lr~ql~nwlerev~-al~~~cd~~s~ak~~~~-~~~ 1624 (2439)
T KOG1064|consen 1548 LRQKSKNDTE-DIFAQQLKFVACLKILMEELSTLATGYESDGGKLRYQLYNWLEREVK-ALKDTCDYCSSAKSKSS-KSG 1624 (2439)
T ss_pred             hhhhhcCChH-HHHHHHHHHHHHHHHHHHHHhcccccccccchhHHHHhhhhhhhhHH-HHHhHHhhhhhhhcccc-ccc
Confidence            7888899999 99999999999999999999999999999999999888888877888 66666667888888877 999


Q ss_pred             hhHHHHHHhhhheeeeecccCCcCCccccccccccccccccccchHHHHHHHHHHHHHHHHhhcCCCcccccchh-hhhH
Q 000080         1660 EDISIFLSRFIAATSITCSHLKSTNSENVRHHEVRSRWSNAQGYYFQSIIFSLWSLRAAMRTFSGSFPEELITPL-FLLD 1738 (2389)
Q Consensus      1660 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~r~~~~~~~~~~~~~~-~~~d 1738 (2389)
                      ++.+++++|. .+|..+  |..+++++|.++.+++++|++|.++||||++...+..+|..|.+.|...|++.... +..|
T Consensus      1625 ~~~s~~~~~~-~a~~~p--h~~~~~~~~~~~~~~r~~Wl~a~q~llr~~ls~cslh~a~~~~lasv~mEll~ll~~~q~e 1701 (2439)
T KOG1064|consen 1625 DEKSLLLDRE-AACDVP--HQIKCFRLQRESAGKRKKWLKANQFLLRGFLSYCSLHGASGGGLASVRMELLLLLQEVQQE 1701 (2439)
T ss_pred             chhhhhhccc-ccccCC--chhhhhhhchhhcccchHHHHHHHHHHHHHHHHHhhccccCCcchhhhHHHHHHHHHHHHH
Confidence            9999999999 999999  99999999999999999999999999999999999999999999999999999988 9999


Q ss_pred             HHHHHHHHHHHHhhcccccceeeeecEEEEeecCCcceeechHhHHHHHHHhhhhhccccccccccccceeeeecccccc
Q 000080         1739 LYEYYVHFASAWLQRDSKGLLQVLQPVLITYTNGHTPYEVDMNNLKTFFHQSAELLTRNTSIDNMVGDLQVSKFVDDERS 1818 (2389)
Q Consensus      1739 l~e~~~~~~~~w~~~~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1818 (2389)
                      +.||++.-+++|- .+...|..|++|..+.+.|+|+|||++...+++++||.+.  .+++++.+++++.+.+-+++....
T Consensus      1702 ~~~~~l~~~l~~~-~t~plL~a~va~~k~~vanp~~~le~~~~dil~~i~q~~~--~p~p~~~~~~v~~l~sl~~~~s~~ 1778 (2439)
T KOG1064|consen 1702 TTEYQLSSPLPWP-TTVPLLFACVAPLKTVVANPLLYLENQTHDILRAIIQEAS--VPHPDASDVKVYVLHSLAVSLSAC 1778 (2439)
T ss_pred             hHHHHHhcccCCC-cchhHHHHhhcCceEEEecCceehhhhHHHHHHHHHhccC--CCCCChhhcceeeehhhHhhhcce
Confidence            9999999999999 9999999999999999999999999999999999999999  889999999999999999999999


Q ss_pred             ccccCCCCccccceeehhhHHHHHHHHHHhhhhccccccccccccccccCccccccccCCCCCccchhhHHHHHHHHHHH
Q 000080         1819 TDLMNSIPEDERWQIMGACLWQHMSRFMKHKLNSMSVKLDENHSSRLLGGHISSWTSSLTNPESASIGLKEQMRLLTLFL 1898 (2389)
Q Consensus      1819 ~~~~~~~~~~e~~~~~~~~~w~~~s~~~~~~l~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1898 (2389)
                      .+..++.|+++ +.|...   .|++.|.|.++...+++.++   .....|.|..+++ ....|.++..+..-+..+ +|.
T Consensus      1779 iY~~l~~~~~~-~ll~~r---~~~~~~s~~~~~t~~~~p~~---wpgvs~l~~ll~~-~~~~d~~~l~vll~E~~~-av~ 1849 (2439)
T KOG1064|consen 1779 IYQSLCDSESY-CLLTQR---PRLRTGSKDELVTPNTSPAQ---WPGVSGLIALLDS-EKEEDQSKLNVLLCESFV-AVY 1849 (2439)
T ss_pred             eeeeecccccc-ccccCC---CccccccccccccccCCccc---ccchHHHHHHhhh-ccccccCcceEeehHHHH-HHH
Confidence            99999999999 444444   89999999999999999998   5667788999988 889999999999999755 699


Q ss_pred             HHHHHHHHHHHhhHHHHHHHHHHHHHhhcCCCCchhhhhhhhCCCCcchhhhhhhhhhhcccccccccchhHHHHHHhhc
Q 000080         1899 AQLLKSALLHISSHHVKQLAFFLRYKVENGFDIPTRRWLQEATPSQSGTLYQHLNQIVVSMNIINNKDEAAISELLWDVC 1978 (2389)
Q Consensus      1899 ~~~~~~~~~~~ss~~~k~~~~~~~~~~~~~~~~~~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 1978 (2389)
                      +++++.+|...||||+++++....++.+.++..++..|| +|+ +|+.++..+++    ++.+.+.+++..++. --.+|
T Consensus      1850 ~slfi~~Lat~sS~~l~rl~~~~~n~~~~~~~fggg~~l-~~k-~~a~~~~~~ap----~~~e~t~~n~~~~~t-~~~~~ 1922 (2439)
T KOG1064|consen 1850 LSLFIHALATLSSRELFRLVAHPLNNLMWSLVFGGGLKL-ECK-PQAQSLNRDAP----SLSEETKENESKVST-PSKVS 1922 (2439)
T ss_pred             HHHHHHHHHhccHHHHHHHhccccChhheeeeecCceee-eec-CcccCCCCCCC----cccccccccCCCCCC-CCCCC
Confidence            999999999999999999999999999999999999995 444 89999999998    555555555544444 22999


Q ss_pred             CCCccccccccccccccccccccccCcchhhhhhcceeeeccccccccccccCcccccCcccccccccccCCCCCCCccc
Q 000080         1979 SDPSIIHEGFTQEKLNWRSYINCKLSKGWSHINEGVKLKHEIKKTCKNEDKLGSTLASGEVGSASKDLFRNSRTSPRSWH 2058 (2389)
Q Consensus      1979 ~~p~~~~~~f~~e~~~~~~~~~~~~~~~w~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 2058 (2389)
                      +||..++|.|+.|+++.++|+..||.+.|.|+++++....|.++ ++.+     .+++++..++..+....      || 
T Consensus      1923 ~~~~~~~ekfippe~~i~~~f~~KP~~~~~D~d~s~~sdne~~~-~~~D-----~~~s~~~l~e~~~~~s~------sw- 1989 (2439)
T KOG1064|consen 1923 VDSPALHEKFIPPELSIWDYFKAKPSEDWYDSDESVESDNEDYV-DDDD-----VRSSDEQLSEHNNPNSY------SW- 1989 (2439)
T ss_pred             CCchhhhhhcCCccccHHHHHhcCcccccccchhhhcccchhcc-cccc-----ccccHHHHHhhcCCccc------cH-
Confidence            99999999999999999999999999999999999999999999 8886     56666666654444322      22 


Q ss_pred             ccccccccccCCCCchhhhhcccceeeeeecccCCCcceEEeecccceEEeeecccccccccccceeccCCCCCCCCCCC
Q 000080         2059 KDANMANEVIPFQAPKEICKRNGELFEALCVNSIDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWADADWPQNGWAGS 2138 (2389)
Q Consensus      2059 ~~~~~~~~~~~f~~~~~~~~~~~~~~~a~~~n~~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 2138 (2389)
                      +....+.++..|+|+||+|||-|+.++++|+|.||..|+.+++| ++++++|..+..+-..+.+|+|..|+|++++|+-.
T Consensus      1990 ~ll~la~~~~~~hn~k~~~~~aG~~~spl~~n~i~~~~a~~~~~-g~ai~~~~~l~~~~ntpf~s~~s~a~~~~rlW~~l 2068 (2439)
T KOG1064|consen 1990 SLLRLAMVQLALHNVKEFHKRAGEDISPLCRNYINHRQAELSSN-GPAILRNKALLEPSNTPFKSIDSSADSVKRLWAYL 2068 (2439)
T ss_pred             HHHHHHHHHHHhhhhHhhhhhhcccccccccccccccchhhhcC-CcceeehHhhcCccCCcccccccccccHHHHHHHH
Confidence            23458889999999999999999999999999999999999999 99999999999999999999999999999999999


Q ss_pred             cccccCCccCCCccccCCCCcccccCCcccccccccCCCccccCcccccc------------------------------
Q 000080         2139 ESTPVPTFVSPGVGLGSNKGAHLGLGGATIGVGSLARPGRDLTGGLAFGI------------------------------ 2188 (2389)
Q Consensus      2139 ~s~p~~~~~s~~~g~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~------------------------------ 2188 (2389)
                      |+++++++|.-++|++.+++.|+++|+..-+    .+.+|+.--=.||+.                              
T Consensus      2069 v~q~~~qevfik~if~k~~~~e~~lG~~g~~----~~iike~e~ivaf~~n~~s~~~ia~an~~~~qe~dvs~~~~~q~~ 2144 (2439)
T KOG1064|consen 2069 VKQEVLQEVFIKYIFTKKKEIEADLGYSGGK----ARIIKESEEIVAFPVNKESVNTIAFANHHDVQEFDVSSSLAHQYY 2144 (2439)
T ss_pred             hcccccceeeeeehhccCCccccccCcCCCc----eeEeecccceeccCcCcCCcceEEecCCCcchheeccchhhhhhh
Confidence            9999999999999999999999999865211    233333211112221                              


Q ss_pred             -----------ccccccceeecc---ccccccc----cccccC------------------CCCcCceeEEEEEEcCCCC
Q 000080         2189 -----------PGYAGIGASALG---WETQDDF----EDYVDP------------------PATVENISTRAFSSHPLRP 2232 (2389)
Q Consensus      2189 -----------~g~~~~~Asg~~---~d~~~~~----~~~~d~------------------~atv~ni~VrsVAFsPdG~ 2232 (2389)
                                 -| .+-.|.+..   ...+...    ..|.+.                  ...++  .|+++.-||.-+
T Consensus      2145 ~w~~ne~d~~~~~-~d~~~~~s~~~~l~~~~~~~~~s~~~~~~n~~~~~~tq~~~~~~~~~k~~v~--~v~r~~sHp~~~ 2221 (2439)
T KOG1064|consen 2145 WWFGNERDTETKG-VDPDANHSPPDALASQSTVGSFSNRFTPSNLPWLGSTQTSRGASVMIKHPVE--NVRRMTSHPSDP 2221 (2439)
T ss_pred             hhhcchhhhhhcC-CCcccccCchhhcccccccccccccCCcccCCccccceecccceeEeecccC--ceeeecCCCCCc
Confidence                       11 111111111   1112222    111110                  11233  459999999999


Q ss_pred             eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccce
Q 000080         2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPME 2312 (2389)
Q Consensus      2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~ 2312 (2389)
                      +.+|||+||.||+|+++.|+.+.+++.        +|. +.|+.+.|+.+|+.++.+..||.+.+|++.-      +++.
T Consensus      2222 ~Yltgs~dgsv~~~~w~~~~~v~~~rt--------~g~-s~vtr~~f~~qGnk~~i~d~dg~l~l~q~~p------k~~~ 2286 (2439)
T KOG1064|consen 2222 YYLTGSQDGSVRMFEWGHGQQVVCFRT--------AGN-SRVTRSRFNHQGNKFGIVDGDGDLSLWQASP------KPYT 2286 (2439)
T ss_pred             eEEecCCCceEEEEeccCCCeEEEeec--------cCc-chhhhhhhcccCCceeeeccCCceeecccCC------ccee
Confidence            999999999999999999999999873        345 8899999999999999999999999999972      7999


Q ss_pred             eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080         2313 SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus      2313 tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
                      +.+||+....+++|..   +++||+|.++++++|.+||++.++...+-. .||.++++++++-|+-.-.+|--|
T Consensus      2287 s~qchnk~~~Df~Fi~---s~~~tag~s~d~~n~~lwDtl~~~~~s~v~-~~H~~gaT~l~~~P~~qllisggr 2356 (2439)
T KOG1064|consen 2287 SWQCHNKALSDFRFIG---SLLATAGRSSDNRNVCLWDTLLPPMNSLVH-TCHDGGATVLAYAPKHQLLISGGR 2356 (2439)
T ss_pred             ccccCCccccceeeee---hhhhccccCCCCCcccchhcccCcccceee-eecCCCceEEEEcCcceEEEecCC
Confidence            9999999999999996   899999999999999999999888877433 999999999999888766666443


No 2  
>PF12234 Rav1p_C:  RAVE protein 1 C terminal;  InterPro: IPR022033  This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits. 
Probab=100.00  E-value=1.3e-141  Score=1320.97  Aligned_cols=618  Identities=32%  Similarity=0.526  Sum_probs=526.1

Q ss_pred             CcEEEEEEEeCCCCCCceeeeeeeeeecCCCCceEEEeecCCCeEEEEccCCCCCCccEEEEEeeccccCcceeEeecee
Q 000080          747 GSLRLWRSELGGSSTSCMPWELVGMLVAHQGPVSAISLTDGGRKIATVSAASHSNAVSNVRIWESVCVTELGSFVLEDTL  826 (2389)
Q Consensus       747 G~VRfWkc~v~~~~~~~y~We~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~~~~~s~vsIWD~~~~sgGGswvLE~ti  826 (2389)
                      |+||+|+++|+.+. ..+.|.++..+.++..+|..|+||.+| |+|++++     .+++|+|||+    .+|  +||+++
T Consensus         1 g~~~~~~a~v~~~~-~~~~w~~t~~~~T~i~~~~li~gss~~-k~a~V~~-----~~~~LtIWD~----~~~--~lE~~~   67 (631)
T PF12234_consen    1 GRIRTWTARVDTES-NKIEWLLTSTFETGISNPSLISGSSIK-KIAVVDS-----SRSELTIWDT----RSG--VLEYEE   67 (631)
T ss_pred             CeeEEEEEEEcCCC-CeEEEEEEEEEecCCCCcceEeecccC-cEEEEEC-----CCCEEEEEEc----CCc--EEEEee
Confidence            78999999998775 589999999999999999999999998 6788865     5889999997    455  577777


Q ss_pred             cc--CCceEEEEeEEccCCcEEEEEeecceEEEEEeccCCcccccccccccccccceeeccCCCCC-ccccccccCceEE
Q 000080          827 SF--DTNIVAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSLKMQNWFCLAFSPTFA-AHDFTWGRRAIAI  903 (2389)
Q Consensus       827 ~l--d~~IVdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll~~~~w~~Id~~~T~h-IgDssWVRDGILV  903 (2389)
                      .|  ++.|+||||||+||||+||+|||+++|+||+|+||||++..|.+...++.+   | .++||| |||++|++||+||
T Consensus        68 ~f~~~~~I~dLDWtst~d~qsiLaVGf~~~v~l~~Q~R~dy~~~~p~w~~i~~i~---i-~~~T~h~Igds~Wl~~G~Lv  143 (631)
T PF12234_consen   68 SFSEDDPIRDLDWTSTPDGQSILAVGFPHHVLLYTQLRYDYTNKGPSWAPIRKID---I-SSHTPHPIGDSIWLKDGTLV  143 (631)
T ss_pred             eecCCCceeeceeeecCCCCEEEEEEcCcEEEEEEccchhhhcCCcccceeEEEE---e-ecCCCCCccceeEecCCeEE
Confidence            77  789999999999999999999999999999999999888755554444311   1 369999 9999999999999


Q ss_pred             EEecCeeEEeeccchhhccccccccCCCccccccccccCCCCCCceeeecccccccCccCCCCCcccCCCcccccccccc
Q 000080          904 VVHQSYLSIYSQFLFLIDKKHQAKCNSNVFIDNFCCHKSGINENIVSTIFTVCDSESSAGDQRGDYESAPSVNIDMKNDH  983 (2389)
Q Consensus       904 VGmgnEMhVYSQWl~~~~~k~q~~~~~~~~~~~~~~~~s~~~~~lv~~i~~~~ds~~~a~~ql~~~~s~~~~~~~~~s~s  983 (2389)
                      ||+||||+||.+|.. .                        ...+.                                  
T Consensus       144 V~sGNqlfv~dk~~~-~------------------------~~~l~----------------------------------  164 (631)
T PF12234_consen  144 VGSGNQLFVFDKWLD-T------------------------SQSLG----------------------------------  164 (631)
T ss_pred             EEeCCEEEEECCCcC-c------------------------hhhcc----------------------------------
Confidence            999999999999985 0                        01110                                  


Q ss_pred             cccccccccCCccccccCHHHHHHHHcCCCCCcchHHHHHHHHcCCchhHHHHHHHHHHhccCCCCCcccccccCCCCCC
Q 000080          984 LVASDQLKCGGAILGSWSMLEIAEKLRGSLPVYHPKALFLNIYSGNWKRAYVSVRHLVENLPSNYPSEKRYCYTKSSHIV 1063 (2389)
Q Consensus       984 ~i~~~~~~~~~~~~~~~~Lfe~~~~LnGpLPvYHPqfLiQ~L~~GK~~rVK~IL~~Lvk~L~~~~~~~~~~~~~e~~~~~ 1063 (2389)
                               +......+||||+|++||||||+||||||+|||++||+++|++||.||+++|+.....+  ...  . +..
T Consensus       165 ---------~~~~~~~~dl~~~v~~LngpLPvYHPqfL~q~l~~Gk~~lv~~IL~~L~~~L~~~~~~~--i~~--~-~~~  230 (631)
T PF12234_consen  165 ---------SRKILPNWDLFELVSRLNGPLPVYHPQFLIQLLLSGKFKLVKKILLHLFKCLRFLDEGE--ISD--L-DSF  230 (631)
T ss_pred             ---------ccccCccCCHHHHHHHhCCCCCCcCHHHHHHHHHcCCHHHHHHHHHHHHHHHHhhcccc--ccc--c-ccc
Confidence                     00111227899999999999999999999999999999999999999999999865321  111  1 124


Q ss_pred             cccchhhhhcccccCCCCCCCccccCCCcccchhhhhhccccccccCCCCCCCchhhhhHHHHhhhccccccCCCHHHHH
Q 000080         1064 PQILLSTYFEGLLSKGSTDNGFQWSGLNTFSTSLQFRQFAYNMDLDASNSSSSTKSELSGFVELLQNVYELAGVTDAEKM 1143 (2389)
Q Consensus      1064 p~i~l~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~f~~~~~~~d~d~~~~~~~~~~~~s~l~E~L~k~~sLPgLT~~EQm 1143 (2389)
                      +.+++++|+....+.....+..           ..+...+.    ..+.+..++++.++.++|.|+++ +||+||+|||+
T Consensus       231 l~i~~~~~~~~~~~~~~~~~~~-----------~~~~~~~~----~~~~~~~f~~~~a~~L~e~L~~~-~LP~Lt~~EQ~  294 (631)
T PF12234_consen  231 LGIPLEKFYESDESDSSVDKTE-----------SSSDQKDL----SDEEFSKFNEELADSLSEKLTKI-SLPGLTRHEQM  294 (631)
T ss_pred             cCCcHHHHhccCcccccccccc-----------cccccccc----cccCccccCHHHHHHHHHHhhcC-CccCCCHHHHH
Confidence            6788888886543221110000           00000111    12223356788999999999998 99999999999


Q ss_pred             HHHHHHHHHHHhhccccccccccCCccccchhhHHHHHHHHHhhhcCccccccccccccccchhhhcccCHHHHHhhcCC
Q 000080         1144 EILAVVDLLNEFDNKHSASVYENLDEPGQRFWVELRFQLLCFFRRFGKLVSAEELAVDSRLIAWAFHSECQETLFGSILP 1223 (2389)
Q Consensus      1144 ~Llalidtv~~i~k~~~~~~~~sLDenGlRFLl~~k~~ql~~lr~~~~~~~~~~~~Ls~r~i~WA~HSesqe~LL~~v~~ 1223 (2389)
                      +|++||||+++++++     +++||+||+|||+++|++++  .++.     .++.+|++|+|+||+||++||+|++.+.+
T Consensus       295 ~L~~iie~v~~v~~~-----~~~lD~~g~Rfll~~r~~~~--~~~~-----~~~~~l~~~~i~WA~hS~~qe~Ll~~~~~  362 (631)
T PF12234_consen  295 TLLAIIETVAEVEKN-----RRSLDENGLRFLLSVRLHQL--HRKS-----LEQSSLSTRDIAWAFHSDSQEELLSLVPP  362 (631)
T ss_pred             HHHHHHHHHHHhhhc-----ccCCChhHHHHHHHHHHHHh--hccc-----ccccCcCHHHHHHHHhccCHHHHHHHhhh
Confidence            999999999999976     68999999999999998653  2221     34458999999999999999999998865


Q ss_pred             CC-CCHHHHHHcCcEEEEeChHHHHHHHHHHHHHHHhc--cCCcchhHHHHHHhcchHHHHHHHhcccCCC-chhHHhHh
Q 000080         1224 NE-PTWPEMRALGVGFWYTDVTQLRTRMEKLARLQYLK--KKDPKDCALLYIALNRIQVLAGLFKISKDEK-DKPLVGFL 1299 (2389)
Q Consensus      1224 ~~-~sW~~~r~~Gv~~Wl~~~~~Lr~~~EkIAr~ey~~--~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k-~~~m~~FL 1299 (2389)
                      .. ++|+++|++||+||+++.+.||+++|+|||++|++  +|||++|||||+|||||+||+||||++.+++ +++|.+||
T Consensus       363 ~~~~~W~~~r~~gv~~W~~~~~~Lr~~~E~iAr~~~~~~~~~dp~~~al~YlAl~Kk~vL~~L~k~a~~~~~~~k~~~Fl  442 (631)
T PF12234_consen  363 QIKLSWEEARELGVGFWLRSIESLRSQFEKIARNEFQKNDTKDPSDCALFYLALGKKKVLAGLWKMASWHKEQQKMAKFL  442 (631)
T ss_pred             hccCCHHHHHhhCCEEeecCHHHHHHHHHHHHHHHHhhccCCCHHHHHHHHHHhccHHHHHHHHHhhhcccccHHHHHHH
Confidence            43 79999999999999999999999999999999998  5999999999999999999999999988764 68999999


Q ss_pred             hcccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhcc
Q 000080         1300 SRNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFIL 1379 (2389)
Q Consensus      1300 snDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vL 1379 (2389)
                      +|||+|||||+||+||||||||||||++|||||||||+++|||+||++||+|+||||+||||||||+||+++++|+++||
T Consensus       443 ~ndF~~~rwr~AAlKNAyaLlsk~Ry~~AAaFFLLag~l~dAv~V~~~~l~D~qLAi~i~Rl~e~d~gp~~~~ll~~~vL  522 (631)
T PF12234_consen  443 SNDFTEPRWRTAALKNAYALLSKHRYEYAAAFFLLAGSLKDAVNVCLRQLNDPQLAIAIARLYEGDNGPVLKKLLEEHVL  522 (631)
T ss_pred             hhcCCChHHHHHHHHhHHHHHhcccHHHHHHHHHhcccHHHHHHHHHHHccChhHHHHHHHHHcCCCchHHHHHHHHhhh
Confidence            99999999999999999999999999999999999999999999999999999999999999999999999999999999


Q ss_pred             ccccccCChhHHHHHHHHhCChhHHHHHHhcCccccccccccc-----cCCCccCCChHHHHHHHHhhccccchhhhccc
Q 000080         1380 PSSIERGDYWLTSLLEWELGNYSQSFLTMLGFQSTAVINNFAL-----SSNSVAFMDPSIGLYCLMLANKNSMRNAIGEK 1454 (2389)
Q Consensus      1380 p~a~~~gDrwL~S~a~W~L~~~~~Av~~Ll~~p~~~~~~~s~l-----~s~~~~f~DPaL~l~~~~L~sk~~~r~~~g~~ 1454 (2389)
                      |.|.++|||||+||+||+||||++|+++|++.+...+.+.+..     .++++..+||+|+++|++||+|+ +++++|..
T Consensus       523 p~a~~~~d~wl~s~~~W~L~~~~~ai~~Li~~~~~~~~~~~~~~~~~~~~~sfl~~dp~L~~ly~~Lr~k~-~~~~~g~~  601 (631)
T PF12234_consen  523 PEAIKEGDRWLASWAFWMLGDYDEAIRALISPPIDLLNESPLSPSSPCNSKSFLVDDPALVVLYQQLRSKN-LQTLKGAS  601 (631)
T ss_pred             ccccccCCHHHHHHHHHhcCCHHHHHHHHhcCccccccccccccccccccccccCCCcHHHHHHHHHHHhc-ccccchhc
Confidence            9999999999999999999999999999998887765443322     23355567999999999999996 99999999


Q ss_pred             hhhhhHHHHHHHHHHH-HHhcCCChhhhhc
Q 000080         1455 NAAILGRWAALMRATA-LNRCGLPLEALDC 1483 (2389)
Q Consensus      1455 ~~~~~~r~~~l~~a~~-l~RmGC~lLALdl 1483 (2389)
                      ++...+||.|++++++ |+|||||+|||+|
T Consensus       602 ~i~~~~E~~fvl~~a~~y~RmGCd~LaL~L  631 (631)
T PF12234_consen  602 KISPKEEFEFVLRVARIYDRMGCDLLALSL  631 (631)
T ss_pred             cCCcHHHHHHHHHHHHHHHHcCCchhhccC
Confidence            9999999988888766 8999999999986


No 3  
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.96  E-value=2.3e-29  Score=284.98  Aligned_cols=165  Identities=25%  Similarity=0.499  Sum_probs=146.2

Q ss_pred             eeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeE
Q 000080           85 RQVFALSDNSLPVTSISWSPETPSIGQLAAA--SENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGI  160 (2389)
Q Consensus        85 ~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rL  160 (2389)
                      -|.++||.+  +||.|||||-   .|.|+|+  .|++||||...+     ...|.|+.+|.  |+++||+|||+|+|++|
T Consensus         7 ~~~~~gh~~--r~W~~awhp~---~g~ilAscg~Dk~vriw~~~~-----~~s~~ck~vld~~hkrsVRsvAwsp~g~~L   76 (312)
T KOG0645|consen    7 EQKLSGHKD--RVWSVAWHPG---KGVILASCGTDKAVRIWSTSS-----GDSWTCKTVLDDGHKRSVRSVAWSPHGRYL   76 (312)
T ss_pred             EEeecCCCC--cEEEEEeccC---CceEEEeecCCceEEEEecCC-----CCcEEEEEeccccchheeeeeeecCCCcEE
Confidence            478899988  9999999992   3778875  479999998761     22599999995  89999999999999999


Q ss_pred             EEEecc--eEEeeccCCcEEEEEEeeccccceEE-EEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcccee
Q 000080          161 VAGGME--TVLWKKKNTLWEIAWKFKENYPQNLV-SATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK  236 (2389)
Q Consensus       161 aSggdD--V~IW~~~~s~Wecvwt~~~~~~~~iv-svaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~  236 (2389)
                      |++|+|  +.||+...+.|||+.++  ++|+++| +|+||++|. +|||+++            |+||||+.+++.+|++
T Consensus        77 a~aSFD~t~~Iw~k~~~efecv~~l--EGHEnEVK~Vaws~sG~~LATCSRD------------KSVWiWe~deddEfec  142 (312)
T KOG0645|consen   77 ASASFDATVVIWKKEDGEFECVATL--EGHENEVKCVAWSASGNYLATCSRD------------KSVWIWEIDEDDEFEC  142 (312)
T ss_pred             EEeeccceEEEeecCCCceeEEeee--eccccceeEEEEcCCCCEEEEeeCC------------CeEEEEEecCCCcEEE
Confidence            999999  99999999999999775  5678888 899999999 9999998            7899999997777776


Q ss_pred             --ecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080          237 --LELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMD  286 (2389)
Q Consensus       237 --ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d  286 (2389)
                        +.+.|+|||++|.|||             ..++|+|||||+|||+|++.+
T Consensus       143 ~aVL~~HtqDVK~V~WHP-------------t~dlL~S~SYDnTIk~~~~~~  181 (312)
T KOG0645|consen  143 IAVLQEHTQDVKHVIWHP-------------TEDLLFSCSYDNTIKVYRDED  181 (312)
T ss_pred             EeeeccccccccEEEEcC-------------CcceeEEeccCCeEEEEeecC
Confidence              6899999999999999             368999999999999999886


No 4  
>KOG0645 consensus WD40 repeat protein [General function prediction only]
Probab=99.95  E-value=3.2e-27  Score=267.71  Aligned_cols=201  Identities=18%  Similarity=0.276  Sum_probs=164.5

Q ss_pred             CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-
Q 000080           36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA-  114 (2389)
Q Consensus        36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA-  114 (2389)
                      +|-.++..++|+++  | ..+|=++-+.-|=.|=-+-...|++.      .+|+.|.+  |||.|.|||    +.+||+ 
T Consensus       103 GHEnEVK~Vaws~s--G-~~LATCSRDKSVWiWe~deddEfec~------aVL~~Htq--DVK~V~WHP----t~dlL~S  167 (312)
T KOG0645|consen  103 GHENEVKCVAWSAS--G-NYLATCSRDKSVWIWEIDEDDEFECI------AVLQEHTQ--DVKHVIWHP----TEDLLFS  167 (312)
T ss_pred             ccccceeEEEEcCC--C-CEEEEeeCCCeEEEEEecCCCcEEEE------eeeccccc--cccEEEEcC----CcceeEE
Confidence            78999999999998  7 58888876666655511234568888      99999855  999999999    577774 


Q ss_pred             -ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeeccccce
Q 000080          115 -ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYPQN  190 (2389)
Q Consensus       115 -SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~~~  190 (2389)
                       |||||||+|+.++     +.+|.|.++|. |++|||+++|++.|+||+||++|  |+||..-       +.....|.+.
T Consensus       168 ~SYDnTIk~~~~~~-----dddW~c~~tl~g~~~TVW~~~F~~~G~rl~s~sdD~tv~Iw~~~-------~~~~~~~sr~  235 (312)
T KOG0645|consen  168 CSYDNTIKVYRDED-----DDDWECVQTLDGHENTVWSLAFDNIGSRLVSCSDDGTVSIWRLY-------TDLSGMHSRA  235 (312)
T ss_pred             eccCCeEEEEeecC-----CCCeeEEEEecCccceEEEEEecCCCceEEEecCCcceEeeeec-------cCcchhcccc
Confidence             6899999999872     44799999997 78899999999999999999998  9999754       3345788899


Q ss_pred             EEEEeecCCCceEeeecccc---cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080          191 LVSATWSIEGPSATAASMSQ---LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR  267 (2389)
Q Consensus       191 ivsvaWSpdG~fATag~dik---f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~  267 (2389)
                      +|.++|. +|.|||+|+|-+   |++.  +..+.|.|-.       +...+++|.++||+|+|+|            .++
T Consensus       236 ~Y~v~W~-~~~IaS~ggD~~i~lf~~s--~~~d~p~~~l-------~~~~~~aHe~dVNsV~w~p------------~~~  293 (312)
T KOG0645|consen  236 LYDVPWD-NGVIASGGGDDAIRLFKES--DSPDEPSWNL-------LAKKEGAHEVDVNSVQWNP------------KVS  293 (312)
T ss_pred             eEeeeec-ccceEeccCCCEEEEEEec--CCCCCchHHH-------HHhhhcccccccceEEEcC------------CCC
Confidence            9999999 999999999655   5555  3344555522       4446899999999999999            468


Q ss_pred             ceEEeeecCCeEEEEEee
Q 000080          268 HVLLTCCLDGTVRLWCEM  285 (2389)
Q Consensus       268 nILAScSdDgTVRLW~e~  285 (2389)
                      ++|+||+|||+||+|...
T Consensus       294 ~~L~s~~DDG~v~~W~l~  311 (312)
T KOG0645|consen  294 NRLASGGDDGIVNFWELE  311 (312)
T ss_pred             CceeecCCCceEEEEEec
Confidence            899999999999999864


No 5  
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.93  E-value=4e-26  Score=276.70  Aligned_cols=175  Identities=21%  Similarity=0.355  Sum_probs=159.6

Q ss_pred             ccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCC
Q 000080         2185 AFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAA 2263 (2389)
Q Consensus      2185 ~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh 2263 (2389)
                      -|-++|+|||..++|+|+|.+++.+|   +|+.++|  |+|+.||+.|+++|+|+|.+||+||++.+. |.++|.     
T Consensus        68 nWiv~GsDD~~IrVfnynt~ekV~~F---eAH~DyI--R~iavHPt~P~vLtsSDDm~iKlW~we~~wa~~qtfe-----  137 (794)
T KOG0276|consen   68 NWIVTGSDDMQIRVFNYNTGEKVKTF---EAHSDYI--RSIAVHPTLPYVLTSSDDMTIKLWDWENEWACEQTFE-----  137 (794)
T ss_pred             ceEEEecCCceEEEEecccceeeEEe---eccccce--eeeeecCCCCeEEecCCccEEEEeeccCceeeeeEEc-----
Confidence            47789999999999999999999999   7888877  999999999999999999999999999885 788884     


Q ss_pred             CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC-CCCEEEEeecCC
Q 000080         2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS-SGSVIAAAGHSS 2341 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~-DGslLASAG~sS 2341 (2389)
                           ||++.|++|+|+|.. ++|||||.|+|||+|++.+.     .|.+|++||...|++|.|.|. |..+|.||   +
T Consensus       138 -----GH~HyVMqv~fnPkD~ntFaS~sLDrTVKVWslgs~-----~~nfTl~gHekGVN~Vdyy~~gdkpylIsg---a  204 (794)
T KOG0276|consen  138 -----GHEHYVMQVAFNPKDPNTFASASLDRTVKVWSLGSP-----HPNFTLEGHEKGVNCVDYYTGGDKPYLISG---A  204 (794)
T ss_pred             -----CcceEEEEEEecCCCccceeeeeccccEEEEEcCCC-----CCceeeeccccCcceEEeccCCCcceEEec---C
Confidence                 678999999999986 89999999999999999864     689999999999999999983 23488886   6


Q ss_pred             CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2342 NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2342 ~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      +|.||||||.  ++.+|+++|+||++.|..+.|+|..-.+.|-
T Consensus       205 DD~tiKvWDy--Qtk~CV~TLeGHt~Nvs~v~fhp~lpiiisg  245 (794)
T KOG0276|consen  205 DDLTIKVWDY--QTKSCVQTLEGHTNNVSFVFFHPELPIIISG  245 (794)
T ss_pred             CCceEEEeec--chHHHHHHhhcccccceEEEecCCCcEEEEe
Confidence            9999999998  7899999999999999999999998887763


No 6  
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.90  E-value=2.3e-22  Score=241.93  Aligned_cols=288  Identities=19%  Similarity=0.252  Sum_probs=201.6

Q ss_pred             ccccccccCCCCCCCcceeec-CCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCC
Q 000080           27 FLRSEFIPTAPTRSTSTIDWL-PDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPE  105 (2389)
Q Consensus        27 ~~~~~~ip~ap~~~~~ai~wl-pD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd  105 (2389)
                      ....+++||-|.|.|++..-+ .|++| .-|+|..|..+++++|++|...          +++..|.+  +|+.+++|| 
T Consensus         4 ~~lk~~~~~lPst~Rg~~~~ig~dpkg-d~ilY~nGksv~ir~i~~~~~~----------~iYtEH~~--~vtVAkySP-   69 (603)
T KOG0318|consen    4 YELKETFASLPSTERGVPIIIGGDPKG-DNILYTNGKSVIIRNIDNPASV----------DIYTEHAH--QVTVAKYSP-   69 (603)
T ss_pred             hhhhhhccCCCcccCCcceEeccCCCC-CeEEEeCCCEEEEEECCCccce----------eeeccccc--eeEEEEeCC-
Confidence            456899999999999999998 99999 6999999999999999998876          45556766  999999999 


Q ss_pred             CCCCCcEEEecC--CeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc------eEEeeccCCc
Q 000080          106 TPSIGQLAAASE--NCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME------TVLWKKKNTL  176 (2389)
Q Consensus       106 ~~~~GeIaASyD--ntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD------V~IW~~~~s~  176 (2389)
                         +|+.+||+|  ++||||.-..      .+-..+..+ +..++|-+|+|+++|+||+++|++      +-+|+.+++.
T Consensus        70 ---sG~yiASGD~sG~vRIWdtt~------~~hiLKnef~v~aG~I~Di~Wd~ds~RI~avGEGrerfg~~F~~DSG~Sv  140 (603)
T KOG0318|consen   70 ---SGFYIASGDVSGKVRIWDTTQ------KEHILKNEFQVLAGPIKDISWDFDSKRIAAVGEGRERFGHVFLWDSGNSV  140 (603)
T ss_pred             ---CceEEeecCCcCcEEEEeccC------cceeeeeeeeecccccccceeCCCCcEEEEEecCccceeEEEEecCCCcc
Confidence               699999987  9999997651      022333333 478999999999999999999996      5599976555


Q ss_pred             EEEEEEe--------------------------------------eccccceEEEEeecCCCc-eEeeecccccccCCCC
Q 000080          177 WEIAWKF--------------------------------------KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPK  217 (2389)
Q Consensus       177 Wecvwt~--------------------------------------~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~  217 (2389)
                      .|...+.                                      ..+|..=+.+|.+||||. |||+|.|.|       
T Consensus       141 Gei~GhSr~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r~HskFV~~VRysPDG~~Fat~gsDgk-------  213 (603)
T KOG0318|consen  141 GEITGHSRRINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFREHSKFVNCVRYSPDGSRFATAGSDGK-------  213 (603)
T ss_pred             ceeeccceeEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeecccccccceeeEEECCCCCeEEEecCCcc-------
Confidence            4443322                                      223333333999999999 999999987       


Q ss_pred             CCCceeEEEeeCCCccceee----cccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccc-
Q 000080          218 EAGKCVFICCSDGKSEYIKL----ELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRK-  292 (2389)
Q Consensus       218 ~~~kpV~V~~~dg~~~~~~v----e~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk-  292 (2389)
                             +..+||+.+....    ..+|...|++++|+|        |+++     +||+|.|.|+|||+...+-..|+ 
T Consensus       214 -------i~iyDGktge~vg~l~~~~aHkGsIfalsWsP--------Ds~~-----~~T~SaDkt~KIWdVs~~slv~t~  273 (603)
T KOG0318|consen  214 -------IYIYDGKTGEKVGELEDSDAHKGSIFALSWSP--------DSTQ-----FLTVSADKTIKIWDVSTNSLVSTW  273 (603)
T ss_pred             -------EEEEcCCCccEEEEecCCCCccccEEEEEECC--------CCce-----EEEecCCceEEEEEeeccceEEEe
Confidence                   3345666543322    358999999999999        9999     99999999999999776533333 


Q ss_pred             -cccccCC-------CCccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeeccCCccceecccccccccceeeee
Q 000080          293 -VAKDTND-------HKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETGEGANHFISTGVYEHGGTGKCEW  364 (2389)
Q Consensus       293 -~~~~~~d-------~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~~~~s~~~~~~~v~~~eW  364 (2389)
                       .++.+-|       ||....+-.+--.||+=+ ..|  +.+..+.=.-||..---+--..+.++.++.||   -..++|
T Consensus       274 ~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln-~~d--~~~~~~i~GHnK~ITaLtv~~d~~~i~SgsyD---G~I~~W  347 (603)
T KOG0318|consen  274 PMGSTVEDQQVGCLWQKDHLITVSLSGTINYLN-PSD--PSVLKVISGHNKSITALTVSPDGKTIYSGSYD---GHINSW  347 (603)
T ss_pred             ecCCchhceEEEEEEeCCeEEEEEcCcEEEEec-ccC--CChhheecccccceeEEEEcCCCCEEEeeccC---ceEEEE
Confidence             3333333       344446666666666322 122  22333433444432211111113456666665   356778


Q ss_pred             eEeecC
Q 000080          365 LVGYGP  370 (2389)
Q Consensus       365 ~~~~~P  370 (2389)
                      ..+-+-
T Consensus       348 ~~~~g~  353 (603)
T KOG0318|consen  348 DSGSGT  353 (603)
T ss_pred             ecCCcc
Confidence            765443


No 7  
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.88  E-value=7.4e-23  Score=242.09  Aligned_cols=173  Identities=16%  Similarity=0.186  Sum_probs=152.1

Q ss_pred             ccccceeeccccccccccccccCCC--CcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC
Q 000080         2191 YAGIGASALGWETQDDFEDYVDPPA--TVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP 2266 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~d~~a--tv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p 2266 (2389)
                      ++.+++++ .+|.+=|+|+......  ..+  .-+|.+|+|+|||.+++|||.|..-|+||+++|+++..|.        
T Consensus       272 sG~~L~Ta-sfD~tWRlWD~~tk~ElL~QEGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtgr~im~L~--------  342 (459)
T KOG0272|consen  272 SGKFLGTA-SFDSTWRLWDLETKSELLLQEGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTGRCIMFLA--------  342 (459)
T ss_pred             CCceeeec-ccccchhhcccccchhhHhhcccccccceeEecCCCceeeccCccchhheeecccCcEEEEec--------
Confidence            34567778 9999999998841111  111  2366999999999999999999999999999999998884        


Q ss_pred             CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                        ||...|.+|+|||+|..|||||.|+|+|+||++..     +++.+..+|++-|+.|.|+|+.|.+|+|+   |.|+|+
T Consensus       343 --gH~k~I~~V~fsPNGy~lATgs~Dnt~kVWDLR~r-----~~ly~ipAH~nlVS~Vk~~p~~g~fL~Ta---syD~t~  412 (459)
T KOG0272|consen  343 --GHIKEILSVAFSPNGYHLATGSSDNTCKVWDLRMR-----SELYTIPAHSNLVSQVKYSPQEGYFLVTA---SYDNTV  412 (459)
T ss_pred             --ccccceeeEeECCCceEEeecCCCCcEEEeeeccc-----ccceecccccchhhheEecccCCeEEEEc---ccCcce
Confidence              68899999999999999999999999999999953     56899999999999999999899999997   589999


Q ss_pred             EEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      +||..  .+..++++|+||++.|-+++.+++|.++++-
T Consensus       413 kiWs~--~~~~~~ksLaGHe~kV~s~Dis~d~~~i~t~  448 (459)
T KOG0272|consen  413 KIWST--RTWSPLKSLAGHEGKVISLDISPDSQAIATS  448 (459)
T ss_pred             eeecC--CCcccchhhcCCccceEEEEeccCCceEEEe
Confidence            99998  5778899999999999999999999998863


No 8  
>KOG0272 consensus U4/U6 small nuclear ribonucleoprotein Prp4 (contains WD40 repeats) [RNA processing and modification]
Probab=99.87  E-value=1.1e-22  Score=240.60  Aligned_cols=173  Identities=18%  Similarity=0.192  Sum_probs=150.9

Q ss_pred             cc-ccccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080         2189 PG-YAGIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus      2189 ~g-~~~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
                      |+ .+.-+|++ +.|.+.++|.+.  .++++++.  .+|.+|+|||+|++|+|+|.|.|-||||+.+++.+.-.      
T Consensus       227 P~~~~~~lat~-s~Dgtvklw~~~~e~~l~~l~gH~~RVs~VafHPsG~~L~TasfD~tWRlWD~~tk~ElL~Q------  299 (459)
T KOG0272|consen  227 PVDSDLNLATA-SADGTVKLWKLSQETPLQDLEGHLARVSRVAFHPSGKFLGTASFDSTWRLWDLETKSELLLQ------  299 (459)
T ss_pred             cCCCccceeee-ccCCceeeeccCCCcchhhhhcchhhheeeeecCCCceeeecccccchhhcccccchhhHhh------
Confidence            55 45578888 999999999986  34455554  57799999999999999999999999999999875432      


Q ss_pred             CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                          -||+..|.+|+|.|||..+|||+.|..=|+||+++|     +++..+.||.+.|.+|+|+| +|..|||+   |.|
T Consensus       300 ----EGHs~~v~~iaf~~DGSL~~tGGlD~~~RvWDlRtg-----r~im~L~gH~k~I~~V~fsP-NGy~lATg---s~D  366 (459)
T KOG0272|consen  300 ----EGHSKGVFSIAFQPDGSLAATGGLDSLGRVWDLRTG-----RCIMFLAGHIKEILSVAFSP-NGYHLATG---SSD  366 (459)
T ss_pred             ----cccccccceeEecCCCceeeccCccchhheeecccC-----cEEEEecccccceeeEeECC-CceEEeec---CCC
Confidence                267899999999999999999999999999999998     47889999999999999999 99999996   699


Q ss_pred             CeEEEeeCCCCCCCceEEEEeecCcEEEEeecc-cchhhhc
Q 000080         2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLK-LLNFALS 2383 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~-~~~~~~s 2383 (2389)
                      +|+||||+.  ..+++.++.+|++-|+-|-++| -|.|.++
T Consensus       367 nt~kVWDLR--~r~~ly~ipAH~nlVS~Vk~~p~~g~fL~T  405 (459)
T KOG0272|consen  367 NTCKVWDLR--MRSELYTIPAHSNLVSQVKYSPQEGYFLVT  405 (459)
T ss_pred             CcEEEeeec--ccccceecccccchhhheEecccCCeEEEE
Confidence            999999984  4566999999999999999998 6777665


No 9  
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.83  E-value=1.7e-20  Score=219.88  Aligned_cols=135  Identities=16%  Similarity=0.233  Sum_probs=122.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|-+++|+|+|..|||||.|.|+||||..+.....|.+          ||.+||.+|++||||+.||||+.||+|+|||.
T Consensus       117 ~Vl~~~fsp~g~~l~tGsGD~TvR~WD~~TeTp~~t~K----------gH~~WVlcvawsPDgk~iASG~~dg~I~lwdp  186 (480)
T KOG0271|consen  117 AVLSVQFSPTGSRLVTGSGDTTVRLWDLDTETPLFTCK----------GHKNWVLCVAWSPDGKKIASGSKDGSIRLWDP  186 (480)
T ss_pred             cEEEEEecCCCceEEecCCCceEEeeccCCCCcceeec----------CCccEEEEEEECCCcchhhccccCCeEEEecC
Confidence            56889999999999999999999999999988888874          67899999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecC----CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITS----SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~----DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      ++|+    +...++.||..+|.+++|-|-    .+++|||+   |.|++|||||+.  .++|+.++.||++.|+||--
T Consensus       187 ktg~----~~g~~l~gH~K~It~Lawep~hl~p~~r~las~---skDg~vrIWd~~--~~~~~~~lsgHT~~VTCvrw  255 (480)
T KOG0271|consen  187 KTGQ----QIGRALRGHKKWITALAWEPLHLVPPCRRLASS---SKDGSVRIWDTK--LGTCVRTLSGHTASVTCVRW  255 (480)
T ss_pred             CCCC----cccccccCcccceeEEeecccccCCCccceecc---cCCCCEEEEEcc--CceEEEEeccCccceEEEEE
Confidence            9985    456889999999999999863    66799985   699999999983  57899999999999999864


No 10 
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.83  E-value=8.1e-20  Score=226.99  Aligned_cols=145  Identities=18%  Similarity=0.277  Sum_probs=131.7

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeec-CCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEF-GKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl-~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      -.|+.++|+|||+++++|+.|++||+||+ .++.+++++.          ||...|++++|+|+|+.++||+.|+|||+|
T Consensus       204 ~~v~~~~fs~d~~~l~s~s~D~tiriwd~~~~~~~~~~l~----------gH~~~v~~~~f~p~g~~i~Sgs~D~tvriW  273 (456)
T KOG0266|consen  204 RGVSDVAFSPDGSYLLSGSDDKTLRIWDLKDDGRNLKTLK----------GHSTYVTSVAFSPDGNLLVSGSDDGTVRIW  273 (456)
T ss_pred             cceeeeEECCCCcEEEEecCCceEEEeeccCCCeEEEEec----------CCCCceEEEEecCCCCEEEEecCCCcEEEE
Confidence            46799999999999999999999999999 5668888884          578999999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC--ceEEEEeecCc--EEEEee
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS--SRASITCHEGL--YDLFLP 2374 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~--~v~sL~GH~~~--V~svA~ 2374 (2389)
                      |++++     ++...+.+|+..|++++|++ ||++|+++   +.|++|+|||+  .++.  ++..+.+|++.  ++++.+
T Consensus       274 d~~~~-----~~~~~l~~hs~~is~~~f~~-d~~~l~s~---s~d~~i~vwd~--~~~~~~~~~~~~~~~~~~~~~~~~f  342 (456)
T KOG0266|consen  274 DVRTG-----ECVRKLKGHSDGISGLAFSP-DGNLLVSA---SYDGTIRVWDL--ETGSKLCLKLLSGAENSAPVTSVQF  342 (456)
T ss_pred             eccCC-----eEEEeeeccCCceEEEEECC-CCCEEEEc---CCCccEEEEEC--CCCceeeeecccCCCCCCceeEEEE
Confidence            99986     58899999999999999999 99999996   57999999998  4566  67899999988  999999


Q ss_pred             cccchhhhccc
Q 000080         2375 LKLLNFALSKC 2385 (2389)
Q Consensus      2375 ~~~~~~~~s~~ 2385 (2389)
                      +|+|.++++..
T Consensus       343 sp~~~~ll~~~  353 (456)
T KOG0266|consen  343 SPNGKYLLSAS  353 (456)
T ss_pred             CCCCcEEEEec
Confidence            99999988754


No 11 
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.82  E-value=3.7e-20  Score=231.58  Aligned_cols=144  Identities=24%  Similarity=0.287  Sum_probs=133.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .+|..++|+|+.++|+|+|+|++||||.+.+-.++..|+          ||..+|+.|+|+|-|-+|||||.|+|-+||.
T Consensus       452 GPVyg~sFsPd~rfLlScSED~svRLWsl~t~s~~V~y~----------GH~~PVwdV~F~P~GyYFatas~D~tArLWs  521 (707)
T KOG0263|consen  452 GPVYGCSFSPDRRFLLSCSEDSSVRLWSLDTWSCLVIYK----------GHLAPVWDVQFAPRGYYFATASHDQTARLWS  521 (707)
T ss_pred             CceeeeeecccccceeeccCCcceeeeecccceeEEEec----------CCCcceeeEEecCCceEEEecCCCceeeeee
Confidence            467999999999999999999999999999999999985          4667899999999999999999999999998


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      ....     +|++.+.||.+.|.+|+|+| ++.++|||   |.|+|||+||+  .+|.+|+.|.||.+.|.+|+++|.|+
T Consensus       522 ~d~~-----~PlRifaghlsDV~cv~FHP-Ns~Y~aTG---SsD~tVRlWDv--~~G~~VRiF~GH~~~V~al~~Sp~Gr  590 (707)
T KOG0263|consen  522 TDHN-----KPLRIFAGHLSDVDCVSFHP-NSNYVATG---SSDRTVRLWDV--STGNSVRIFTGHKGPVTALAFSPCGR  590 (707)
T ss_pred             cccC-----CchhhhcccccccceEEECC-cccccccC---CCCceEEEEEc--CCCcEEEEecCCCCceEEEEEcCCCc
Confidence            8753     79999999999999999999 89999995   69999999998  68999999999999999999999999


Q ss_pred             hhhcc
Q 000080         2380 FALSK 2384 (2389)
Q Consensus      2380 ~~~s~ 2384 (2389)
                      |..|-
T Consensus       591 ~LaSg  595 (707)
T KOG0263|consen  591 YLASG  595 (707)
T ss_pred             eEeec
Confidence            98763


No 12 
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.81  E-value=4e-19  Score=203.27  Aligned_cols=225  Identities=18%  Similarity=0.185  Sum_probs=174.4

Q ss_pred             ceeeeeecccCCCcceEEeecccceEEeeecccccccccccceeccCCCCCCCCCCCcccccCCccCCCccccCCCC-cc
Q 000080         2082 ELFEALCVNSIDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWADADWPQNGWAGSESTPVPTFVSPGVGLGSNKG-AH 2160 (2389)
Q Consensus      2082 ~~~~a~~~n~~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~s~p~~~~~s~~~g~~~~~g-~~ 2160 (2389)
                      +-|.+++|..-|++.++=||.-|-++-.++.-.              ||.-                 |+-..+.+| +|
T Consensus        16 d~Vt~la~~~~~~~~l~sasrDk~ii~W~L~~d--------------d~~~-----------------G~~~r~~~GHsH   64 (315)
T KOG0279|consen   16 DWVTALAIKIKNSDILVSASRDKTIIVWKLTSD--------------DIKY-----------------GVPVRRLTGHSH   64 (315)
T ss_pred             ceEEEEEeecCCCceEEEcccceEEEEEEeccC--------------cccc-----------------Cceeeeeeccce
Confidence            457899999999988888888888855444322              3332                 333667888 55


Q ss_pred             cccCCcccccccccCCCccccCccccccccccccceeeccccccccccccccCCCCc--Cc--eeEEEEEEcCCCCeEEE
Q 000080         2161 LGLGGATIGVGSLARPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATV--EN--ISTRAFSSHPLRPFFLV 2236 (2389)
Q Consensus      2161 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv--~n--i~VrsVAFsPdG~~LAS 2236 (2389)
                      .--+.+-+             ..|        -+..++ +||.+-|+|+......+.  .+  --|-+|+|+||.+.|+|
T Consensus        65 ~v~dv~~s-------------~dg--------~~alS~-swD~~lrlWDl~~g~~t~~f~GH~~dVlsva~s~dn~qivS  122 (315)
T KOG0279|consen   65 FVSDVVLS-------------SDG--------NFALSA-SWDGTLRLWDLATGESTRRFVGHTKDVLSVAFSTDNRQIVS  122 (315)
T ss_pred             EecceEEc-------------cCC--------ceEEec-cccceEEEEEecCCcEEEEEEecCCceEEEEecCCCceeec
Confidence            54433311             111        224566 999999999985432221  11  24589999999999999


Q ss_pred             EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080         2237 GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus      2237 GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
                      ||.|.||+|||+ -|.|..|..   .+     +|.++|.+|.|+|.  .-.|+++|.|+|||+||+++-     +...++
T Consensus       123 GSrDkTiklwnt-~g~ck~t~~---~~-----~~~~WVscvrfsP~~~~p~Ivs~s~DktvKvWnl~~~-----~l~~~~  188 (315)
T KOG0279|consen  123 GSRDKTIKLWNT-LGVCKYTIH---ED-----SHREWVSCVRFSPNESNPIIVSASWDKTVKVWNLRNC-----QLRTTF  188 (315)
T ss_pred             CCCcceeeeeee-cccEEEEEe---cC-----CCcCcEEEEEEcCCCCCcEEEEccCCceEEEEccCCc-----chhhcc
Confidence            999999999998 578887764   11     34799999999999  679999999999999999863     456788


Q ss_pred             eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      .||++.++.+++|| ||.+.|+||   .|+.+-|||+  ..++++++|. |-..|.+++|+|---|
T Consensus       189 ~gh~~~v~t~~vSp-DGslcasGg---kdg~~~LwdL--~~~k~lysl~-a~~~v~sl~fspnryw  247 (315)
T KOG0279|consen  189 IGHSGYVNTVTVSP-DGSLCASGG---KDGEAMLWDL--NEGKNLYSLE-AFDIVNSLCFSPNRYW  247 (315)
T ss_pred             ccccccEEEEEECC-CCCEEecCC---CCceEEEEEc--cCCceeEecc-CCCeEeeEEecCCcee
Confidence            99999999999999 999999975   9999999998  4678899998 8889999999997544


No 13 
>KOG0263 consensus Transcription initiation factor TFIID, subunit TAF5 (also component of histone acetyltransferase SAGA) [Transcription]
Probab=99.81  E-value=1.2e-19  Score=227.00  Aligned_cols=139  Identities=22%  Similarity=0.365  Sum_probs=118.0

Q ss_pred             eeeccccccccccccc--cCCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCC
Q 000080         2196 ASALGWETQDDFEDYV--DPPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYAL 2271 (2389)
Q Consensus      2196 Asg~~~d~~~~~~~~~--d~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~ 2271 (2389)
                      |++ +.|.+.++|...  +|.+-.-  .--|.+++|||+..++|+||.|.|||+||+.+|..++.|.          ||.
T Consensus       509 ata-s~D~tArLWs~d~~~PlRifaghlsDV~cv~FHPNs~Y~aTGSsD~tVRlWDv~~G~~VRiF~----------GH~  577 (707)
T KOG0263|consen  509 ATA-SHDQTARLWSTDHNKPLRIFAGHLSDVDCVSFHPNSNYVATGSSDRTVRLWDVSTGNSVRIFT----------GHK  577 (707)
T ss_pred             Eec-CCCceeeeeecccCCchhhhcccccccceEEECCcccccccCCCCceEEEEEcCCCcEEEEec----------CCC
Confidence            455 566666777542  3333311  1234889999999999999999999999999999999984          678


Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +.|.+|+|||+|++||||+.||.|++||+.+|     +++.++.+|++.|+++.|+. ||.+||++|   .|++|+|||+
T Consensus       578 ~~V~al~~Sp~Gr~LaSg~ed~~I~iWDl~~~-----~~v~~l~~Ht~ti~SlsFS~-dg~vLasgg---~DnsV~lWD~  648 (707)
T KOG0263|consen  578 GPVTALAFSPCGRYLASGDEDGLIKIWDLANG-----SLVKQLKGHTGTIYSLSFSR-DGNVLASGG---ADNSVRLWDL  648 (707)
T ss_pred             CceEEEEEcCCCceEeecccCCcEEEEEcCCC-----cchhhhhcccCceeEEEEec-CCCEEEecC---CCCeEEEEEc
Confidence            99999999999999999999999999999987     47888999999999999999 999999974   8999999998


Q ss_pred             CCC
Q 000080         2352 LAP 2354 (2389)
Q Consensus      2352 l~~ 2354 (2389)
                      ...
T Consensus       649 ~~~  651 (707)
T KOG0263|consen  649 TKV  651 (707)
T ss_pred             hhh
Confidence            543


No 14 
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.80  E-value=2.2e-19  Score=222.80  Aligned_cols=174  Identities=14%  Similarity=0.184  Sum_probs=152.9

Q ss_pred             cccccccceeeccccccccccccccCCCCcC-------------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080         2188 IPGYAGIGASALGWETQDDFEDYVDPPATVE-------------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus      2188 ~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~-------------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
                      -.|++...++| +-|-+.++|++.+...+..             .=.|.+|+.+|+.++|||||.|.|.|||++.+++..
T Consensus       420 ~~~~asffvsv-S~D~tlK~W~l~~s~~~~~~~~~~~~~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~~l~  498 (775)
T KOG0319|consen  420 SKLGASFFVSV-SQDCTLKLWDLPKSKETAFPIVLTCRYTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQLRLL  498 (775)
T ss_pred             cccCccEEEEe-cCCceEEEecCCCcccccccceehhhHHHHhhcccccceEecCCCceEEecccccceeeecccCceEE
Confidence            45667778999 8888899998865212211             114688999999999999999999999999988888


Q ss_pred             eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080         2255 ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus      2255 ~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
                      .++.          ||...|++|.|+|..+.+||+|.|+|||||.+.+.     .++.++.||+..|..+.|.. +|+.|
T Consensus       499 ~vLs----------GH~RGvw~V~Fs~~dq~laT~SgD~TvKIW~is~f-----SClkT~eGH~~aVlra~F~~-~~~ql  562 (775)
T KOG0319|consen  499 GVLS----------GHTRGVWCVSFSKNDQLLATCSGDKTVKIWSISTF-----SCLKTFEGHTSAVLRASFIR-NGKQL  562 (775)
T ss_pred             EEee----------CCccceEEEEeccccceeEeccCCceEEEEEeccc-----eeeeeecCccceeEeeeeee-CCcEE
Confidence            8884          67899999999999999999999999999999987     47999999999999999999 88999


Q ss_pred             EEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2335 AAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2335 ASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      .|+|   .||-||||++  .++.|+++|..|++.||.++-+++++++++
T Consensus       563 iS~~---adGliKlWni--kt~eC~~tlD~H~DrvWaL~~~~~~~~~~t  606 (775)
T KOG0319|consen  563 ISAG---ADGLIKLWNI--KTNECEMTLDAHNDRVWALSVSPLLDMFVT  606 (775)
T ss_pred             Eecc---CCCcEEEEec--cchhhhhhhhhccceeEEEeecCccceeEe
Confidence            9975   8999999998  588999999999999999999999998874


No 15 
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.78  E-value=1.5e-18  Score=199.24  Aligned_cols=167  Identities=18%  Similarity=0.230  Sum_probs=133.7

Q ss_pred             ccccccceeeccccccccccccccCCCCcCceeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      ||++||-.----=++-+++..|..+...     |-+++++| +++.++||+.|++.+|||++.|.++++|.         
T Consensus       161 T~SGD~TCalWDie~g~~~~~f~GH~gD-----V~slsl~p~~~ntFvSg~cD~~aklWD~R~~~c~qtF~---------  226 (343)
T KOG0286|consen  161 TGSGDMTCALWDIETGQQTQVFHGHTGD-----VMSLSLSPSDGNTFVSGGCDKSAKLWDVRSGQCVQTFE---------  226 (343)
T ss_pred             ecCCCceEEEEEcccceEEEEecCCccc-----EEEEecCCCCCCeEEecccccceeeeeccCcceeEeec---------
Confidence            5555555544222233344444333333     38899999 99999999999999999999999999983         


Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                       ||...|.+|+|.|+|.-||+||+|+|.|++|++.. ++  -.+++...-...|++|+||- +|++|.++   ..|.++.
T Consensus       227 -ghesDINsv~ffP~G~afatGSDD~tcRlyDlRaD-~~--~a~ys~~~~~~gitSv~FS~-SGRlLfag---y~d~~c~  298 (343)
T KOG0286|consen  227 -GHESDINSVRFFPSGDAFATGSDDATCRLYDLRAD-QE--LAVYSHDSIICGITSVAFSK-SGRLLFAG---YDDFTCN  298 (343)
T ss_pred             -ccccccceEEEccCCCeeeecCCCceeEEEeecCC-cE--EeeeccCcccCCceeEEEcc-cccEEEee---ecCCcee
Confidence             67899999999999999999999999999999986 21  23333344457899999999 99999874   4899999


Q ss_pred             EeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      +||++  .++.+..|.||+|+|.||..+|+|-
T Consensus       299 vWDtl--k~e~vg~L~GHeNRvScl~~s~DG~  328 (343)
T KOG0286|consen  299 VWDTL--KGERVGVLAGHENRVSCLGVSPDGM  328 (343)
T ss_pred             Eeecc--ccceEEEeeccCCeeEEEEECCCCc
Confidence            99997  4567899999999999999999984


No 16 
>KOG0271 consensus Notchless-like WD40 repeat-containing protein [Function unknown]
Probab=99.77  E-value=1.8e-18  Score=203.05  Aligned_cols=163  Identities=17%  Similarity=0.165  Sum_probs=137.7

Q ss_pred             ccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC
Q 000080         2193 GIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP 2268 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~ 2268 (2389)
                      ..+|+| +=|++.|+|+..  -|..|...  ..|-+|+|+|||+.||||+-||+|+|||..+|+++-.         +.+
T Consensus       128 ~~l~tG-sGD~TvR~WD~~TeTp~~t~KgH~~WVlcvawsPDgk~iASG~~dg~I~lwdpktg~~~g~---------~l~  197 (480)
T KOG0271|consen  128 SRLVTG-SGDTTVRLWDLDTETPLFTCKGHKNWVLCVAWSPDGKKIASGSKDGSIRLWDPKTGQQIGR---------ALR  197 (480)
T ss_pred             ceEEec-CCCceEEeeccCCCCcceeecCCccEEEEEEECCCcchhhccccCCeEEEecCCCCCcccc---------ccc
Confidence            457788 668999999874  33333332  4679999999999999999999999999999987532         124


Q ss_pred             CCCCCEEEEEEC-----CCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2269 YALASISALQFD-----HYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2269 GH~~~V~sVaFS-----PDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                      ||..+|++++|-     |..++|||+|.||+|+|||+..+     ++++++.||+..|.+|.+-. + .+|+|+   |.|
T Consensus       198 gH~K~It~Lawep~hl~p~~r~las~skDg~vrIWd~~~~-----~~~~~lsgHT~~VTCvrwGG-~-gliySg---S~D  267 (480)
T KOG0271|consen  198 GHKKWITALAWEPLHLVPPCRRLASSSKDGSVRIWDTKLG-----TCVRTLSGHTASVTCVRWGG-E-GLIYSG---SQD  267 (480)
T ss_pred             CcccceeEEeecccccCCCccceecccCCCCEEEEEccCc-----eEEEEeccCccceEEEEEcC-C-ceEEec---CCC
Confidence            788999999986     67789999999999999999975     57899999999999999986 3 688885   799


Q ss_pred             CeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      +|||+|+..  .|.+++.|.||..+|+.+|.+++
T Consensus       268 rtIkvw~a~--dG~~~r~lkGHahwvN~lalsTd  299 (480)
T KOG0271|consen  268 RTIKVWRAL--DGKLCRELKGHAHWVNHLALSTD  299 (480)
T ss_pred             ceEEEEEcc--chhHHHhhcccchheeeeeccch
Confidence            999999984  58899999999999999998854


No 17 
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.77  E-value=3e-18  Score=200.88  Aligned_cols=173  Identities=14%  Similarity=0.135  Sum_probs=145.4

Q ss_pred             ccccccceeecccccccccccccc-------CCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVD-------PPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d-------~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
                      .+++..+|+- +-|.+..+|++..       ...+-  ..|.+|+|=|.|.+|+|+|.|.||+.||+.+|.|+.+|.   
T Consensus       159 ~a~Gk~l~tc-SsDl~~~LWd~~~~~~c~ks~~gh~--h~vS~V~f~P~gd~ilS~srD~tik~We~~tg~cv~t~~---  232 (406)
T KOG0295|consen  159 DASGKYLATC-SSDLSAKLWDFDTFFRCIKSLIGHE--HGVSSVFFLPLGDHILSCSRDNTIKAWECDTGYCVKTFP---  232 (406)
T ss_pred             ecCccEEEec-CCccchhheeHHHHHHHHHHhcCcc--cceeeEEEEecCCeeeecccccceeEEecccceeEEecc---
Confidence            3344555665 5566677777642       22222  245999999999999999999999999999999999983   


Q ss_pred             CCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC------------
Q 000080         2262 AANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS------------ 2329 (2389)
Q Consensus      2262 gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~------------ 2329 (2389)
                             ||..+|+.|+.+-||..+||+|.|.||++|=++++     .+...+.+|+..|.+++|.|.            
T Consensus       233 -------~h~ewvr~v~v~~DGti~As~s~dqtl~vW~~~t~-----~~k~~lR~hEh~vEci~wap~~~~~~i~~at~~  300 (406)
T KOG0295|consen  233 -------GHSEWVRMVRVNQDGTIIASCSNDQTLRVWVVATK-----QCKAELREHEHPVECIAWAPESSYPSISEATGS  300 (406)
T ss_pred             -------CchHhEEEEEecCCeeEEEecCCCceEEEEEeccc-----hhhhhhhccccceEEEEecccccCcchhhccCC
Confidence                   56789999999999999999999999999999986     355667889999999999874            


Q ss_pred             --CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2330 --SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2330 --DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                        .|+.++++   |.|+|||+||+  +++.|+-+|.||.++|+.+|++|.|.|++|-
T Consensus       301 ~~~~~~l~s~---SrDktIk~wdv--~tg~cL~tL~ghdnwVr~~af~p~Gkyi~Sc  352 (406)
T KOG0295|consen  301 TNGGQVLGSG---SRDKTIKIWDV--STGMCLFTLVGHDNWVRGVAFSPGGKYILSC  352 (406)
T ss_pred             CCCccEEEee---cccceEEEEec--cCCeEEEEEecccceeeeeEEcCCCeEEEEE
Confidence              23588775   79999999998  7999999999999999999999999999984


No 18 
>KOG0266 consensus WD40 repeat-containing protein [General function prediction only]
Probab=99.76  E-value=4.3e-18  Score=211.73  Aligned_cols=145  Identities=19%  Similarity=0.230  Sum_probs=130.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      .|..+.|||+|+++++++.|++|++|+..+++  ..+++          .||...|+.++|+|||+.+++|+.|+|||+|
T Consensus       161 sv~~~~fs~~g~~l~~~~~~~~i~~~~~~~~~~~~~~~l----------~~h~~~v~~~~fs~d~~~l~s~s~D~tiriw  230 (456)
T KOG0266|consen  161 SVTCVDFSPDGRALAAASSDGLIRIWKLEGIKSNLLREL----------SGHTRGVSDVAFSPDGSYLLSGSDDKTLRIW  230 (456)
T ss_pred             ceEEEEEcCCCCeEEEccCCCcEEEeecccccchhhccc----------cccccceeeeEECCCCcEEEEecCCceEEEe
Confidence            45789999999999999999999999997777  33333          3677999999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      |++..+    +.++++.||+..|++++|+| +|++|+||   +.|+||||||+  .+++++..|.+|.++|++++++++|
T Consensus       231 d~~~~~----~~~~~l~gH~~~v~~~~f~p-~g~~i~Sg---s~D~tvriWd~--~~~~~~~~l~~hs~~is~~~f~~d~  300 (456)
T KOG0266|consen  231 DLKDDG----RNLKTLKGHSTYVTSVAFSP-DGNLLVSG---SDDGTVRIWDV--RTGECVRKLKGHSDGISGLAFSPDG  300 (456)
T ss_pred             eccCCC----eEEEEecCCCCceEEEEecC-CCCEEEEe---cCCCcEEEEec--cCCeEEEeeeccCCceEEEEECCCC
Confidence            995543    57899999999999999999 88999996   69999999998  5689999999999999999999999


Q ss_pred             hhhhccc
Q 000080         2379 NFALSKC 2385 (2389)
Q Consensus      2379 ~~~~s~~ 2385 (2389)
                      +..++-+
T Consensus       301 ~~l~s~s  307 (456)
T KOG0266|consen  301 NLLVSAS  307 (456)
T ss_pred             CEEEEcC
Confidence            9988765


No 19 
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.75  E-value=5e-18  Score=212.24  Aligned_cols=176  Identities=17%  Similarity=0.173  Sum_probs=145.1

Q ss_pred             cccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2192 AGIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      ..+-.|| |.|-.+++|.|.      ....++++|  |++.||+.-|+|+|+|+|.|||||+|.+++|+.+++       
T Consensus        63 qplFVSG-GDDykIkVWnYk~rrclftL~GHlDYV--Rt~~FHheyPWIlSASDDQTIrIWNwqsr~~iavlt-------  132 (1202)
T KOG0292|consen   63 QPLFVSG-GDDYKIKVWNYKTRRCLFTLLGHLDYV--RTVFFHHEYPWILSASDDQTIRIWNWQSRKCIAVLT-------  132 (1202)
T ss_pred             CCeEEec-CCccEEEEEecccceehhhhcccccee--EEeeccCCCceEEEccCCCeEEEEeccCCceEEEEe-------
Confidence            3566888 999999999885      233445554  999999999999999999999999999999999985       


Q ss_pred             CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc------------------------ceeeeecCCCe
Q 000080         2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP------------------------MESCLCFSSHA 2321 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~------------------------l~tl~gHs~~V 2321 (2389)
                         ||.++|+|-+|.|.-..++|||.|.|||+||+.--.+.+..|                        -.-+.||...|
T Consensus       133 ---GHnHYVMcAqFhptEDlIVSaSLDQTVRVWDisGLRkk~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGV  209 (1202)
T KOG0292|consen  133 ---GHNHYVMCAQFHPTEDLIVSASLDQTVRVWDISGLRKKNKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGV  209 (1202)
T ss_pred             ---cCceEEEeeccCCccceEEEecccceEEEEeecchhccCCCCCCchhhhhccccchhhcCCcCeeeeeeeccccccc
Confidence               577999999999999999999999999999995311000000                        13478999999


Q ss_pred             eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2322 MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2322 ~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      +-+||+| .-.+|+||   ++|+.||||.+.....=.+-+..||.|.|.|+-++|.-+-+||.
T Consensus       210 NwaAfhp-TlpliVSG---~DDRqVKlWrmnetKaWEvDtcrgH~nnVssvlfhp~q~lIlSn  268 (1202)
T KOG0292|consen  210 NWAAFHP-TLPLIVSG---ADDRQVKLWRMNETKAWEVDTCRGHYNNVSSVLFHPHQDLILSN  268 (1202)
T ss_pred             ceEEecC-CcceEEec---CCcceeeEEEeccccceeehhhhcccCCcceEEecCccceeEec
Confidence            9999999 88899986   59999999999533222277889999999999999999988885


No 20 
>KOG0279 consensus G protein beta subunit-like protein [Signal transduction mechanisms]
Probab=99.75  E-value=1e-17  Score=191.91  Aligned_cols=162  Identities=15%  Similarity=0.172  Sum_probs=128.6

Q ss_pred             eccccccccccccccCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2198 ALGWETQDDFEDYVDPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2198 g~~~d~~~~~~~~~d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      .+.|+-+-+-+.|-.+.+.+.+  =.|..++.++||++.+|||.|+++|+||+.+|+..+.|.          ||...|.
T Consensus        40 ii~W~L~~dd~~~G~~~r~~~GHsH~v~dv~~s~dg~~alS~swD~~lrlWDl~~g~~t~~f~----------GH~~dVl  109 (315)
T KOG0279|consen   40 IIVWKLTSDDIKYGVPVRRLTGHSHFVSDVVLSSDGNFALSASWDGTLRLWDLATGESTRRFV----------GHTKDVL  109 (315)
T ss_pred             EEEEEeccCccccCceeeeeeccceEecceEEccCCceEEeccccceEEEEEecCCcEEEEEE----------ecCCceE
Confidence            3445555444444333333322  245788999999999999999999999999998888774          5778999


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCC-CCEEEEeecCCCCCeEEEeeCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSS-GSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~D-GslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      +|+||||.+.+.|||.|+||+|||+-.+      +..+...  |...|++|.|+|.. ..+|+++   |.|+|||+||+ 
T Consensus       110 sva~s~dn~qivSGSrDkTiklwnt~g~------ck~t~~~~~~~~WVscvrfsP~~~~p~Ivs~---s~DktvKvWnl-  179 (315)
T KOG0279|consen  110 SVAFSTDNRQIVSGSRDKTIKLWNTLGV------CKYTIHEDSHREWVSCVRFSPNESNPIIVSA---SWDKTVKVWNL-  179 (315)
T ss_pred             EEEecCCCceeecCCCcceeeeeeeccc------EEEEEecCCCcCcEEEEEEcCCCCCcEEEEc---cCCceEEEEcc-
Confidence            9999999999999999999999999753      3344433  37899999999952 5788887   59999999998 


Q ss_pred             CCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2353 APPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2353 ~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                       .+-+..+.+.||++-++.++.||||--
T Consensus       180 -~~~~l~~~~~gh~~~v~t~~vSpDGsl  206 (315)
T KOG0279|consen  180 -RNCQLRTTFIGHSGYVNTVTVSPDGSL  206 (315)
T ss_pred             -CCcchhhccccccccEEEEEECCCCCE
Confidence             344457899999999999999999953


No 21 
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.74  E-value=1.5e-17  Score=206.39  Aligned_cols=146  Identities=16%  Similarity=0.227  Sum_probs=125.8

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .++.+++++|||+++|||++||.||+||..+|-|+.||.          -|++.|++|+|+..|+.+.|+|.|||||.||
T Consensus       351 ~~i~~l~YSpDgq~iaTG~eDgKVKvWn~~SgfC~vTFt----------eHts~Vt~v~f~~~g~~llssSLDGtVRAwD  420 (893)
T KOG0291|consen  351 DRITSLAYSPDGQLIATGAEDGKVKVWNTQSGFCFVTFT----------EHTSGVTAVQFTARGNVLLSSSLDGTVRAWD  420 (893)
T ss_pred             cceeeEEECCCCcEEEeccCCCcEEEEeccCceEEEEec----------cCCCceEEEEEEecCCEEEEeecCCeEEeee
Confidence            355899999999999999999999999999999999995          2679999999999999999999999999999


Q ss_pred             CCCCCc---------------------------------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecC
Q 000080         2300 LEVGGR---------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHS 2340 (2389)
Q Consensus      2300 l~tggr---------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~s 2340 (2389)
                      +.....                                       +.-+.+..+.||+++|.+++|+| +|+.|||+   
T Consensus       421 lkRYrNfRTft~P~p~QfscvavD~sGelV~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~-~~~~LaS~---  496 (893)
T KOG0291|consen  421 LKRYRNFRTFTSPEPIQFSCVAVDPSGELVCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSP-DGSLLASG---  496 (893)
T ss_pred             ecccceeeeecCCCceeeeEEEEcCCCCEEEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEcc-ccCeEEec---
Confidence            976521                                       11134556789999999999999 99999996   


Q ss_pred             CCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080         2341 SNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2341 S~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
                      |.|+|||+||+.. ....+-+|+ +...|..|+++|+|+.+
T Consensus       497 SWDkTVRiW~if~-s~~~vEtl~-i~sdvl~vsfrPdG~el  535 (893)
T KOG0291|consen  497 SWDKTVRIWDIFS-SSGTVETLE-IRSDVLAVSFRPDGKEL  535 (893)
T ss_pred             cccceEEEEEeec-cCceeeeEe-eccceeEEEEcCCCCeE
Confidence            7999999999974 334567777 88889999999999753


No 22 
>PTZ00421 coronin; Provisional
Probab=99.72  E-value=9.7e-17  Score=201.63  Aligned_cols=142  Identities=17%  Similarity=0.253  Sum_probs=119.8

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCc-------eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeC
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDK-------ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAAL 2291 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk-------~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~ 2291 (2389)
                      .|.+|+|+| ++++|||||.|++|++||+.++.       .+.++          .||...|.+|+|+|++ +.||||+.
T Consensus        77 ~V~~v~fsP~d~~~LaSgS~DgtIkIWdi~~~~~~~~~~~~l~~L----------~gH~~~V~~l~f~P~~~~iLaSgs~  146 (493)
T PTZ00421         77 PIIDVAFNPFDPQKLFTASEDGTIMGWGIPEEGLTQNISDPIVHL----------QGHTKKVGIVSFHPSAMNVLASAGA  146 (493)
T ss_pred             CEEEEEEcCCCCCEEEEEeCCCEEEEEecCCCccccccCcceEEe----------cCCCCcEEEEEeCcCCCCEEEEEeC
Confidence            469999999 89999999999999999997653       23444          2577899999999986 79999999


Q ss_pred             CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE-E
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY-D 2370 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V-~ 2370 (2389)
                      |++|+|||++++     +....+.+|...|.+++|+| +|++|||+   +.|++|+|||+  .+++.+.++.+|.+.+ .
T Consensus       147 DgtVrIWDl~tg-----~~~~~l~~h~~~V~sla~sp-dG~lLatg---s~Dg~IrIwD~--rsg~~v~tl~~H~~~~~~  215 (493)
T PTZ00421        147 DMVVNVWDVERG-----KAVEVIKCHSDQITSLEWNL-DGSLLCTT---SKDKKLNIIDP--RDGTIVSSVEAHASAKSQ  215 (493)
T ss_pred             CCEEEEEECCCC-----eEEEEEcCCCCceEEEEEEC-CCCEEEEe---cCCCEEEEEEC--CCCcEEEEEecCCCCcce
Confidence            999999999986     46678889999999999999 99999996   58999999998  4677789999998754 3


Q ss_pred             EEeecccchhhhc
Q 000080         2371 LFLPLKLLNFALS 2383 (2389)
Q Consensus      2371 svA~~~~~~~~~s 2383 (2389)
                      .+...++++.+++
T Consensus       216 ~~~w~~~~~~ivt  228 (493)
T PTZ00421        216 RCLWAKRKDLIIT  228 (493)
T ss_pred             EEEEcCCCCeEEE
Confidence            5666677666653


No 23 
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.71  E-value=1.1e-16  Score=192.24  Aligned_cols=195  Identities=15%  Similarity=0.196  Sum_probs=155.5

Q ss_pred             CCCccccCccccccccccccceeeccccccccccccc-cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC
Q 000080         2175 RPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYV-DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD 2251 (2389)
Q Consensus      2175 ~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~-d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG 2251 (2389)
                      .+-|+.| +.+|  .+.+..+|.| .++...|+|.-. ....++..  .+|.++.|+-.|.+|+||+-|+|+-|||.-+|
T Consensus       233 ~~nkdVT-~L~W--n~~G~~LatG-~~~G~~riw~~~G~l~~tl~~HkgPI~slKWnk~G~yilS~~vD~ttilwd~~~g  308 (524)
T KOG0273|consen  233 PSNKDVT-SLDW--NNDGTLLATG-SEDGEARIWNKDGNLISTLGQHKGPIFSLKWNKKGTYILSGGVDGTTILWDAHTG  308 (524)
T ss_pred             CccCCcc-eEEe--cCCCCeEEEe-ecCcEEEEEecCchhhhhhhccCCceEEEEEcCCCCEEEeccCCccEEEEeccCc
Confidence            3445554 2445  4566789999 899999999764 22233332  58899999999999999999999999999888


Q ss_pred             ceeeEec--ccCCCC--------------------------CC---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2252 KATATYG--VLPAAN--------------------------VP---PPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2252 k~l~Tl~--vl~gh~--------------------------~p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      +..+-|.  ..|+-.                          -|   ..||.+.|.++.|+|.|..|||+|.|+|+|||..
T Consensus       309 ~~~q~f~~~s~~~lDVdW~~~~~F~ts~td~~i~V~kv~~~~P~~t~~GH~g~V~alk~n~tg~LLaS~SdD~TlkiWs~  388 (524)
T KOG0273|consen  309 TVKQQFEFHSAPALDVDWQSNDEFATSSTDGCIHVCKVGEDRPVKTFIGHHGEVNALKWNPTGSLLASCSDDGTLKIWSM  388 (524)
T ss_pred             eEEEeeeeccCCccceEEecCceEeecCCCceEEEEEecCCCcceeeecccCceEEEEECCCCceEEEecCCCeeEeeec
Confidence            7654442  111000                          01   5689999999999999999999999999999998


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecC--------CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITS--------SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~--------DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      ..+     .....+++|+..|+.+.++|.        +|..||++   +.|+||++||+  ..+.++++|+.|+.+|.+|
T Consensus       389 ~~~-----~~~~~l~~Hskei~t~~wsp~g~v~~n~~~~~~l~sa---s~dstV~lwdv--~~gv~i~~f~kH~~pVysv  458 (524)
T KOG0273|consen  389 GQS-----NSVHDLQAHSKEIYTIKWSPTGPVTSNPNMNLMLASA---SFDSTVKLWDV--ESGVPIHTLMKHQEPVYSV  458 (524)
T ss_pred             CCC-----cchhhhhhhccceeeEeecCCCCccCCCcCCceEEEe---ecCCeEEEEEc--cCCceeEeeccCCCceEEE
Confidence            765     356778899999999999983        34588887   48999999998  4678999999999999999


Q ss_pred             eecccchhhhc
Q 000080         2373 LPLKLLNFALS 2383 (2389)
Q Consensus      2373 A~~~~~~~~~s 2383 (2389)
                      |++|+|++..|
T Consensus       459 afS~~g~ylAs  469 (524)
T KOG0273|consen  459 AFSPNGRYLAS  469 (524)
T ss_pred             EecCCCcEEEe
Confidence            99999999865


No 24 
>KOG0292 consensus Vesicle coat complex COPI, alpha subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.70  E-value=5.5e-17  Score=203.11  Aligned_cols=162  Identities=19%  Similarity=0.255  Sum_probs=136.2

Q ss_pred             ccccccccccCCCCc-----CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEE
Q 000080         2203 TQDDFEDYVDPPATV-----ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISAL 2277 (2389)
Q Consensus      2203 ~~~~~~~~~d~~atv-----~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sV 2277 (2389)
                      ..+++|+|.=. .-+     +..+||.|+|||++++++||++|.+||+|+..+-+|+-|+          .||.++|+.+
T Consensus        31 G~IQlWDYRM~-tli~rFdeHdGpVRgv~FH~~qplFVSGGDDykIkVWnYk~rrclftL----------~GHlDYVRt~   99 (1202)
T KOG0292|consen   31 GVIQLWDYRMG-TLIDRFDEHDGPVRGVDFHPTQPLFVSGGDDYKIKVWNYKTRRCLFTL----------LGHLDYVRTV   99 (1202)
T ss_pred             ceeeeehhhhh-hHHhhhhccCCccceeeecCCCCeEEecCCccEEEEEecccceehhhh----------ccccceeEEe
Confidence            45677777410 001     1246799999999999999999999999999999998887          3788999999


Q ss_pred             EECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC-----
Q 000080         2278 QFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL----- 2352 (2389)
Q Consensus      2278 aFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l----- 2352 (2389)
                      .|.+.=-++.|||+|.|||+||-.++     +++..++||+..|.+..|+| ...+|+||   |-|.|||+||+-     
T Consensus       100 ~FHheyPWIlSASDDQTIrIWNwqsr-----~~iavltGHnHYVMcAqFhp-tEDlIVSa---SLDQTVRVWDisGLRkk  170 (1202)
T KOG0292|consen  100 FFHHEYPWILSASDDQTIRIWNWQSR-----KCIAVLTGHNHYVMCAQFHP-TEDLIVSA---SLDQTVRVWDISGLRKK  170 (1202)
T ss_pred             eccCCCceEEEccCCCeEEEEeccCC-----ceEEEEecCceEEEeeccCC-ccceEEEe---cccceEEEEeecchhcc
Confidence            99999999999999999999999885     58899999999999999999 88999997   699999999971     


Q ss_pred             -CCCC-------------------Cce--EEEEeecCcEEEEeecccchhhhcc
Q 000080         2353 -APPT-------------------SSR--ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2353 -~~tg-------------------~~v--~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                       .+++                   .++  +.|+||+-+|+-.|++|-+--+||-
T Consensus       171 ~~~pg~~e~~~~~~~~~~dLfg~~DaVVK~VLEGHDRGVNwaAfhpTlpliVSG  224 (1202)
T KOG0292|consen  171 NKAPGSLEDQMRGQQGNSDLFGQTDAVVKHVLEGHDRGVNWAAFHPTLPLIVSG  224 (1202)
T ss_pred             CCCCCCchhhhhccccchhhcCCcCeeeeeeecccccccceEEecCCcceEEec
Confidence             1222                   343  5689999999999999977777763


No 25 
>KOG0295 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.68  E-value=2.3e-16  Score=185.34  Aligned_cols=167  Identities=13%  Similarity=0.189  Sum_probs=143.3

Q ss_pred             ccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC
Q 000080         2193 GIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP 2266 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p 2266 (2389)
                      +-.+|- ++|.+++.|++.      ..+++.+  -||-|+.+.||.++||+|.|.||++|=+++++|...++   +    
T Consensus       206 d~ilS~-srD~tik~We~~tg~cv~t~~~h~e--wvr~v~v~~DGti~As~s~dqtl~vW~~~t~~~k~~lR---~----  275 (406)
T KOG0295|consen  206 DHILSC-SRDNTIKAWECDTGYCVKTFPGHSE--WVRMVRVNQDGTIIASCSNDQTLRVWVVATKQCKAELR---E----  275 (406)
T ss_pred             Ceeeec-ccccceeEEecccceeEEeccCchH--hEEEEEecCCeeEEEecCCCceEEEEEeccchhhhhhh---c----
Confidence            666777 889999999873      2222233  46999999999999999999999999999999988775   3    


Q ss_pred             CCCCCCCEEEEEECCC---------------CCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCC
Q 000080         2267 PPYALASISALQFDHY---------------GHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSG 2331 (2389)
Q Consensus      2267 ~~GH~~~V~sVaFSPD---------------G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DG 2331 (2389)
                         |...|-+|+|-|.               |+.++++|.|+|||+||+.+|     .++.++.||..+|++++|+| .|
T Consensus       276 ---hEh~vEci~wap~~~~~~i~~at~~~~~~~~l~s~SrDktIk~wdv~tg-----~cL~tL~ghdnwVr~~af~p-~G  346 (406)
T KOG0295|consen  276 ---HEHPVECIAWAPESSYPSISEATGSTNGGQVLGSGSRDKTIKIWDVSTG-----MCLFTLVGHDNWVRGVAFSP-GG  346 (406)
T ss_pred             ---cccceEEEEecccccCcchhhccCCCCCccEEEeecccceEEEEeccCC-----eEEEEEecccceeeeeEEcC-CC
Confidence               5566888887652               369999999999999999997     58999999999999999999 99


Q ss_pred             CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2332 SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2332 slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      ++|+|.   ++|+|+|+||+  .+.+|.+.+..|+.-|+++++++.-.+.++
T Consensus       347 kyi~Sc---aDDktlrvwdl--~~~~cmk~~~ah~hfvt~lDfh~~~p~VvT  393 (406)
T KOG0295|consen  347 KYILSC---ADDKTLRVWDL--KNLQCMKTLEAHEHFVTSLDFHKTAPYVVT  393 (406)
T ss_pred             eEEEEE---ecCCcEEEEEe--ccceeeeccCCCcceeEEEecCCCCceEEe
Confidence            999996   69999999998  578999999999999999999987665544


No 26 
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.67  E-value=5.1e-16  Score=175.92  Aligned_cols=180  Identities=16%  Similarity=0.193  Sum_probs=138.1

Q ss_pred             ccccccccccceeeccccccccccccc----cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080         2185 AFGIPGYAGIGASALGWETQDDFEDYV----DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus      2185 ~~~~~g~~~~~Asg~~~d~~~~~~~~~----d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
                      +..||-..+++|.+ +|... |+-+..    .|+++.+.  --|.+|.|+-||++.+|||+||++||||++...|-+.|+
T Consensus        45 rLeiTpdk~~LAaa-~~qhv-RlyD~~S~np~Pv~t~e~h~kNVtaVgF~~dgrWMyTgseDgt~kIWdlR~~~~qR~~~  122 (311)
T KOG0315|consen   45 RLEITPDKKDLAAA-GNQHV-RLYDLNSNNPNPVATFEGHTKNVTAVGFQCDGRWMYTGSEDGTVKIWDLRSLSCQRNYQ  122 (311)
T ss_pred             eEEEcCCcchhhhc-cCCee-EEEEccCCCCCceeEEeccCCceEEEEEeecCeEEEecCCCceEEEEeccCcccchhcc
Confidence            45566677777777 66544 444442    35566442  235999999999999999999999999999877777774


Q ss_pred             ccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCC----------------------------------
Q 000080         2259 VLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGG---------------------------------- 2304 (2389)
Q Consensus      2259 vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tgg---------------------------------- 2304 (2389)
                                 |.+.|++|..+|+..-|.+|..+|.|++||+....                                  
T Consensus       123 -----------~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~v~~dgsml~a~nnkG~c  191 (311)
T KOG0315|consen  123 -----------HNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLTVMPDGSMLAAANNKGNC  191 (311)
T ss_pred             -----------CCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEEEcCCCcEEEEecCCccE
Confidence                       23557777777777777777777777777765420                                  


Q ss_pred             ----------ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC-CceEEEEeecCcEEEEe
Q 000080         2305 ----------RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT-SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus      2305 ----------rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg-~~v~sL~GH~~~V~svA 2373 (2389)
                                .+.+.|+..++.|++++....||| |+++|||+   |.|+||+||++.  +- +.-..++||+.+++..+
T Consensus       192 yvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSP-d~k~lat~---ssdktv~iwn~~--~~~kle~~l~gh~rWvWdc~  265 (311)
T KOG0315|consen  192 YVWRLLNHQTASELEPVHKFQAHNGHILRCLLSP-DVKYLATC---SSDKTVKIWNTD--DFFKLELVLTGHQRWVWDCA  265 (311)
T ss_pred             EEEEccCCCccccceEhhheecccceEEEEEECC-CCcEEEee---cCCceEEEEecC--CceeeEEEeecCCceEEeee
Confidence                      034567788899999999999999 99999997   589999999972  22 34578999999999999


Q ss_pred             ecccchhhhc
Q 000080         2374 PLKLLNFALS 2383 (2389)
Q Consensus      2374 ~~~~~~~~~s 2383 (2389)
                      ||-+|.+++.
T Consensus       266 FS~dg~YlvT  275 (311)
T KOG0315|consen  266 FSADGEYLVT  275 (311)
T ss_pred             eccCccEEEe
Confidence            9999999875


No 27 
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.66  E-value=3.8e-16  Score=182.74  Aligned_cols=136  Identities=16%  Similarity=0.239  Sum_probs=124.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..||+|++.|..++++|||.|+||+|||+.+|++..|+          +||...|+.|+||+---++.|+++|+.||-||
T Consensus       152 gWVr~vavdP~n~wf~tgs~DrtikIwDlatg~Lkltl----------tGhi~~vr~vavS~rHpYlFs~gedk~VKCwD  221 (460)
T KOG0285|consen  152 GWVRSVAVDPGNEWFATGSADRTIKIWDLATGQLKLTL----------TGHIETVRGVAVSKRHPYLFSAGEDKQVKCWD  221 (460)
T ss_pred             ceEEEEeeCCCceeEEecCCCceeEEEEcccCeEEEee----------cchhheeeeeeecccCceEEEecCCCeeEEEe
Confidence            46799999999999999999999999999999998887          36889999999999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ++..     +.++.+-||-..|++++.+| .-.+|+|+   +.|.++||||+  .+...+..|.||++.|.+|...|
T Consensus       222 Le~n-----kvIR~YhGHlS~V~~L~lhP-Tldvl~t~---grDst~RvWDi--Rtr~~V~~l~GH~~~V~~V~~~~  287 (460)
T KOG0285|consen  222 LEYN-----KVIRHYHGHLSGVYCLDLHP-TLDVLVTG---GRDSTIRVWDI--RTRASVHVLSGHTNPVASVMCQP  287 (460)
T ss_pred             chhh-----hhHHHhccccceeEEEeccc-cceeEEec---CCcceEEEeee--cccceEEEecCCCCcceeEEeec
Confidence            9974     67888999999999999999 77999997   48999999998  46777999999999999988764


No 28 
>PTZ00421 coronin; Provisional
Probab=99.65  E-value=2.3e-15  Score=189.44  Aligned_cols=173  Identities=13%  Similarity=0.124  Sum_probs=132.2

Q ss_pred             cccceeeccccccccccccccC---------CCCcC--ceeEEEEEEcCCC-CeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080         2192 AGIGASALGWETQDDFEDYVDP---------PATVE--NISTRAFSSHPLR-PFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~d~---------~atv~--ni~VrsVAFsPdG-~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
                      +..+|++ ++|.+.++|+..+.         ..++.  .-.|.+|+|||++ ++|+|||.|++|+|||+.+++.+.++. 
T Consensus        88 ~~~LaSg-S~DgtIkIWdi~~~~~~~~~~~~l~~L~gH~~~V~~l~f~P~~~~iLaSgs~DgtVrIWDl~tg~~~~~l~-  165 (493)
T PTZ00421         88 PQKLFTA-SEDGTIMGWGIPEEGLTQNISDPIVHLQGHTKKVGIVSFHPSAMNVLASAGADMVVNVWDVERGKAVEVIK-  165 (493)
T ss_pred             CCEEEEE-eCCCEEEEEecCCCccccccCcceEEecCCCCcEEEEEeCcCCCCEEEEEeCCCEEEEEECCCCeEEEEEc-
Confidence            3468888 88999999987432         11221  2367999999986 699999999999999999999887773 


Q ss_pred             cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCe-eEEEEecCCCCEEEEee
Q 000080         2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHA-MDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus      2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V-~sVAFSP~DGslLASAG 2338 (2389)
                               +|.+.|++|+|+|||+.||+|+.|++|++||++++     +.+.++.+|.+.+ ..+.|.+ ++..|+++|
T Consensus       166 ---------~h~~~V~sla~spdG~lLatgs~Dg~IrIwD~rsg-----~~v~tl~~H~~~~~~~~~w~~-~~~~ivt~G  230 (493)
T PTZ00421        166 ---------CHSDQITSLEWNLDGSLLCTTSKDKKLNIIDPRDG-----TIVSSVEAHASAKSQRCLWAK-RKDLIITLG  230 (493)
T ss_pred             ---------CCCCceEEEEEECCCCEEEEecCCCEEEEEECCCC-----cEEEEEecCCCCcceEEEEcC-CCCeEEEEe
Confidence                     46688999999999999999999999999999986     4567788898654 4678888 667777776


Q ss_pred             cC-CCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecccchhhh
Q 000080         2339 HS-SNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2339 ~s-S~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~~~~~~~ 2382 (2389)
                      ++ +.|++|+|||+.. ....+.....|. ..+....++++++..+
T Consensus       231 ~s~s~Dr~VklWDlr~-~~~p~~~~~~d~~~~~~~~~~d~d~~~L~  275 (493)
T PTZ00421        231 CSKSQQRQIMLWDTRK-MASPYSTVDLDQSSALFIPFFDEDTNLLY  275 (493)
T ss_pred             cCCCCCCeEEEEeCCC-CCCceeEeccCCCCceEEEEEcCCCCEEE
Confidence            53 4689999999842 223455554443 4455667788887654


No 29 
>PTZ00420 coronin; Provisional
Probab=99.65  E-value=1.7e-15  Score=192.46  Aligned_cols=149  Identities=16%  Similarity=0.193  Sum_probs=114.7

Q ss_pred             eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCce-eeEecccCCCCCCCCCCCCCEEEEEECCCCCE-EEEEeCCCcEEE
Q 000080         2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANVPPPYALASISALQFDHYGHR-FASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~-LASgS~DgTVkL 2297 (2389)
                      .|.+|+|||+ +.+|||||.|++|+|||+.++.. +.++.. +-.  ...||...|.+|+|+|+|.. ||||+.|++|+|
T Consensus        76 ~V~~lafsP~~~~lLASgS~DgtIrIWDi~t~~~~~~~i~~-p~~--~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrI  152 (568)
T PTZ00420         76 SILDLQFNPCFSEILASGSEDLTIRVWEIPHNDESVKEIKD-PQC--ILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNI  152 (568)
T ss_pred             CEEEEEEcCCCCCEEEEEeCCCeEEEEECCCCCcccccccc-ceE--EeecCCCcEEEEEECCCCCeEEEEEeCCCeEEE
Confidence            4699999997 78999999999999999976532 111100 000  01357789999999999975 689999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE-----E
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL-----F 2372 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s-----v 2372 (2389)
                      ||++++.     ....+. |...|.+++|+| +|++||++   +.|++|+|||+  .+++.++++.+|.+.+.+     .
T Consensus       153 WDl~tg~-----~~~~i~-~~~~V~Slswsp-dG~lLat~---s~D~~IrIwD~--Rsg~~i~tl~gH~g~~~s~~v~~~  220 (568)
T PTZ00420        153 WDIENEK-----RAFQIN-MPKKLSSLKWNI-KGNLLSGT---CVGKHMHIIDP--RKQEIASSFHIHDGGKNTKNIWID  220 (568)
T ss_pred             EECCCCc-----EEEEEe-cCCcEEEEEECC-CCCEEEEE---ecCCEEEEEEC--CCCcEEEEEecccCCceeEEEEee
Confidence            9999862     344444 667899999999 99999986   48999999998  467778999999987543     2


Q ss_pred             eecccchhhhcc
Q 000080         2373 LPLKLLNFALSK 2384 (2389)
Q Consensus      2373 A~~~~~~~~~s~ 2384 (2389)
                      .++++++++++-
T Consensus       221 ~fs~d~~~IlTt  232 (568)
T PTZ00420        221 GLGGDDNYILST  232 (568)
T ss_pred             eEcCCCCEEEEE
Confidence            345788887763


No 30 
>KOG0286 consensus G-protein beta subunit [General function prediction only]
Probab=99.65  E-value=8e-16  Score=177.25  Aligned_cols=142  Identities=15%  Similarity=0.178  Sum_probs=123.0

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEe
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLW 2298 (2389)
                      .++.++.|-+|+ .|+|||.|+|.-|||+++|+.+..|.          ||.+.|.++.++| ++++|+||+.|++.+||
T Consensus       146 gylScC~f~dD~-~ilT~SGD~TCalWDie~g~~~~~f~----------GH~gDV~slsl~p~~~ntFvSg~cD~~aklW  214 (343)
T KOG0286|consen  146 GYLSCCRFLDDN-HILTGSGDMTCALWDIETGQQTQVFH----------GHTGDVMSLSLSPSDGNTFVSGGCDKSAKLW  214 (343)
T ss_pred             ceeEEEEEcCCC-ceEecCCCceEEEEEcccceEEEEec----------CCcccEEEEecCCCCCCeEEecccccceeee
Confidence            355888998855 57789999999999999999999883          6889999999999 99999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE--eecCcEEEEeecc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT--CHEGLYDLFLPLK 2376 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~--GH~~~V~svA~~~ 2376 (2389)
                      |++.+     .+.+++.||+..|++|+|.| +|.-+|||   |+|+|.|++|+.  ..+.+..++  .--.+|++|++|+
T Consensus       215 D~R~~-----~c~qtF~ghesDINsv~ffP-~G~afatG---SDD~tcRlyDlR--aD~~~a~ys~~~~~~gitSv~FS~  283 (343)
T KOG0286|consen  215 DVRSG-----QCVQTFEGHESDINSVRFFP-SGDAFATG---SDDATCRLYDLR--ADQELAVYSHDSIICGITSVAFSK  283 (343)
T ss_pred             eccCc-----ceeEeecccccccceEEEcc-CCCeeeec---CCCceeEEEeec--CCcEEeeeccCcccCCceeEEEcc
Confidence            99987     47899999999999999999 99999995   799999999985  344555555  2336788999999


Q ss_pred             cchhhhc
Q 000080         2377 LLNFALS 2383 (2389)
Q Consensus      2377 ~~~~~~s 2383 (2389)
                      +||..+.
T Consensus       284 SGRlLfa  290 (343)
T KOG0286|consen  284 SGRLLFA  290 (343)
T ss_pred             cccEEEe
Confidence            9986553


No 31 
>KOG0319 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.65  E-value=4.4e-16  Score=193.94  Aligned_cols=180  Identities=18%  Similarity=0.148  Sum_probs=144.1

Q ss_pred             ccceeeccccccccccccccC------CCC--cCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080         2193 GIGASALGWETQDDFEDYVDP------PAT--VENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~d~------~at--v~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
                      +.+|+| +-|...++|.+.+.      .+.  -++..|-+|+++-.|. +|+|+|.|+|||+|++...+.......+..-
T Consensus       378 ~llat~-sKD~svilWr~~~~~~~~~~~a~~~gH~~svgava~~~~~asffvsvS~D~tlK~W~l~~s~~~~~~~~~~~~  456 (775)
T KOG0319|consen  378 DLLATG-SKDKSVILWRLNNNCSKSLCVAQANGHTNSVGAVAGSKLGASFFVSVSQDCTLKLWDLPKSKETAFPIVLTCR  456 (775)
T ss_pred             cEEEEe-cCCceEEEEEecCCcchhhhhhhhcccccccceeeecccCccEEEEecCCceEEEecCCCcccccccceehhh
Confidence            578888 89999999977321      111  1224668899987766 8999999999999999763321110000000


Q ss_pred             CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                       .....|...|++|+++|+.+.|||||.|+|.|||+++..     ....++.||...|++|.|+| ..+++||+   |.|
T Consensus       457 -~t~~aHdKdIN~Vaia~ndkLiAT~SqDktaKiW~le~~-----~l~~vLsGH~RGvw~V~Fs~-~dq~laT~---SgD  526 (775)
T KOG0319|consen  457 -YTERAHDKDINCVAIAPNDKLIATGSQDKTAKIWDLEQL-----RLLGVLSGHTRGVWCVSFSK-NDQLLATC---SGD  526 (775)
T ss_pred             -HHHHhhcccccceEecCCCceEEecccccceeeecccCc-----eEEEEeeCCccceEEEEecc-ccceeEec---cCC
Confidence             001247789999999999999999999999999999964     46789999999999999999 66999996   799


Q ss_pred             CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080         2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      +|||||.+  .+..|+++|+||+..|--++|-..|...+|-|
T Consensus       527 ~TvKIW~i--s~fSClkT~eGH~~aVlra~F~~~~~qliS~~  566 (775)
T KOG0319|consen  527 KTVKIWSI--STFSCLKTFEGHTSAVLRASFIRNGKQLISAG  566 (775)
T ss_pred             ceEEEEEe--ccceeeeeecCccceeEeeeeeeCCcEEEecc
Confidence            99999998  68899999999999999999999999998876


No 32 
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.65  E-value=1.5e-16  Score=188.69  Aligned_cols=143  Identities=17%  Similarity=0.228  Sum_probs=126.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .||++.|+++|.+++||..||.||.|+..- .-++.++   +|      |...|++++|||+...|+|+|+||+|+|||.
T Consensus       140 ~Vr~m~ws~~g~wmiSgD~gG~iKyWqpnm-nnVk~~~---ah------h~eaIRdlafSpnDskF~t~SdDg~ikiWdf  209 (464)
T KOG0284|consen  140 PVRTMKWSHNGTWMISGDKGGMIKYWQPNM-NNVKIIQ---AH------HAEAIRDLAFSPNDSKFLTCSDDGTIKIWDF  209 (464)
T ss_pred             cceeEEEccCCCEEEEcCCCceEEecccch-hhhHHhh---Hh------hhhhhheeccCCCCceeEEecCCCeEEEEec
Confidence            579999999999999999999999999753 3333332   23      5588999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      ...     ++-..+.||...|.+|+|+| .-.+|||+   |.|++||+||+  .++.|+.+|.+|.+-|..+-+++.|||
T Consensus       210 ~~~-----kee~vL~GHgwdVksvdWHP-~kgLiasg---skDnlVKlWDp--rSg~cl~tlh~HKntVl~~~f~~n~N~  278 (464)
T KOG0284|consen  210 RMP-----KEERVLRGHGWDVKSVDWHP-TKGLIASG---SKDNLVKLWDP--RSGSCLATLHGHKNTVLAVKFNPNGNW  278 (464)
T ss_pred             cCC-----chhheeccCCCCcceeccCC-ccceeEEc---cCCceeEeecC--CCcchhhhhhhccceEEEEEEcCCCCe
Confidence            865     45567799999999999999 88899997   59999999998  588999999999999999999999999


Q ss_pred             hhcc
Q 000080         2381 ALSK 2384 (2389)
Q Consensus      2381 ~~s~ 2384 (2389)
                      .|+-
T Consensus       279 Llt~  282 (464)
T KOG0284|consen  279 LLTG  282 (464)
T ss_pred             eEEc
Confidence            8874


No 33 
>KOG0315 consensus G-protein beta subunit-like protein (contains WD40 repeats) [General function prediction only]
Probab=99.64  E-value=1.7e-15  Score=171.64  Aligned_cols=171  Identities=14%  Similarity=0.151  Sum_probs=138.7

Q ss_pred             ccceeeccccccccccccccCCCCcCc---eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec-----------
Q 000080         2193 GIGASALGWETQDDFEDYVDPPATVEN---ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG----------- 2258 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~d~~atv~n---i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~----------- 2258 (2389)
                      ....+| +-|.+.|+|+...+....+.   -+|.+|..||+...|++|-++|.||+||+++..|...+.           
T Consensus        96 rWMyTg-seDgt~kIWdlR~~~~qR~~~~~spVn~vvlhpnQteLis~dqsg~irvWDl~~~~c~~~liPe~~~~i~sl~  174 (311)
T KOG0315|consen   96 RWMYTG-SEDGTVKIWDLRSLSCQRNYQHNSPVNTVVLHPNQTELISGDQSGNIRVWDLGENSCTHELIPEDDTSIQSLT  174 (311)
T ss_pred             eEEEec-CCCceEEEEeccCcccchhccCCCCcceEEecCCcceEEeecCCCcEEEEEccCCccccccCCCCCcceeeEE
Confidence            456677 88889999998765554332   467899999999999999999999999999775543321           


Q ss_pred             ccCCCCC-------------------------C---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080         2259 VLPAANV-------------------------P---PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2259 vl~gh~~-------------------------p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
                      +-++..|                         |   ...|...+....||||++.||++|.|.||++|++++.    .+.
T Consensus       175 v~~dgsml~a~nnkG~cyvW~l~~~~~~s~l~P~~k~~ah~~~il~C~lSPd~k~lat~ssdktv~iwn~~~~----~kl  250 (311)
T KOG0315|consen  175 VMPDGSMLAAANNKGNCYVWRLLNHQTASELEPVHKFQAHNGHILRCLLSPDVKYLATCSSDKTVKIWNTDDF----FKL  250 (311)
T ss_pred             EcCCCcEEEEecCCccEEEEEccCCCccccceEhhheecccceEEEEEECCCCcEEEeecCCceEEEEecCCc----eee
Confidence            1111110                         0   4568888999999999999999999999999999864    244


Q ss_pred             ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      -..++||+.++++.+||. ||++|+||   |.|+++||||+  +.++.++..+||.....|++.
T Consensus       251 e~~l~gh~rWvWdc~FS~-dg~YlvTa---ssd~~~rlW~~--~~~k~v~qy~gh~K~~vc~~l  308 (311)
T KOG0315|consen  251 ELVLTGHQRWVWDCAFSA-DGEYLVTA---SSDHTARLWDL--SAGKEVRQYQGHHKAAVCVAL  308 (311)
T ss_pred             EEEeecCCceEEeeeecc-CccEEEec---CCCCceeeccc--ccCceeeecCCcccccEEEEe
Confidence            567899999999999999 99999997   58899999998  678889999999999998875


No 34 
>KOG0285 consensus Pleiotropic regulator 1 [RNA processing and modification]
Probab=99.64  E-value=1.2e-15  Score=178.56  Aligned_cols=172  Identities=14%  Similarity=0.195  Sum_probs=146.6

Q ss_pred             cccceeeccccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2192 AGIGASALGWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      .--.|+| +-|.+.++|+..  ....|+.+  -.||.|+||+-.+|+.|++.|+.||.||+...+-++.|.         
T Consensus       163 n~wf~tg-s~DrtikIwDlatg~LkltltGhi~~vr~vavS~rHpYlFs~gedk~VKCwDLe~nkvIR~Yh---------  232 (460)
T KOG0285|consen  163 NEWFATG-SADRTIKIWDLATGQLKLTLTGHIETVRGVAVSKRHPYLFSAGEDKQVKCWDLEYNKVIRHYH---------  232 (460)
T ss_pred             ceeEEec-CCCceeEEEEcccCeEEEeecchhheeeeeeecccCceEEEecCCCeeEEEechhhhhHHHhc---------
Confidence            4446777 778888888874  33344443  256999999999999999999999999999998888772         


Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                       ||.+.|++++..|.-+.|++|+.|.|+|+||+++.     ..+..+.||...|.+|.+.|-|++++ |+   |.|.|||
T Consensus       233 -GHlS~V~~L~lhPTldvl~t~grDst~RvWDiRtr-----~~V~~l~GH~~~V~~V~~~~~dpqvi-t~---S~D~tvr  302 (460)
T KOG0285|consen  233 -GHLSGVYCLDLHPTLDVLVTGGRDSTIRVWDIRTR-----ASVHVLSGHTNPVASVMCQPTDPQVI-TG---SHDSTVR  302 (460)
T ss_pred             -cccceeEEEeccccceeEEecCCcceEEEeeeccc-----ceEEEecCCCCcceeEEeecCCCceE-Ee---cCCceEE
Confidence             78899999999999999999999999999999985     46888999999999999998666655 64   7999999


Q ss_pred             EeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080         2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      |||+  ..++...++..|..-|++++.+|+.+---|.|
T Consensus       303 lWDl--~agkt~~tlt~hkksvral~lhP~e~~fASas  338 (460)
T KOG0285|consen  303 LWDL--RAGKTMITLTHHKKSVRALCLHPKENLFASAS  338 (460)
T ss_pred             Eeee--ccCceeEeeecccceeeEEecCCchhhhhccC
Confidence            9998  46888999999999999999999987666655


No 35 
>KOG0276 consensus Vesicle coat complex COPI, beta' subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.63  E-value=1.2e-15  Score=186.91  Aligned_cols=144  Identities=15%  Similarity=0.154  Sum_probs=131.1

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
                      +.+++||+..|=+--+++++||+|+.||+++..+++.+.+|.          .|.+.|++|+-.|.--.+.|+|+|-+||
T Consensus        53 V~~~PvRa~kfiaRknWiv~GsDD~~IrVfnynt~ekV~~Fe----------AH~DyIR~iavHPt~P~vLtsSDDm~iK  122 (794)
T KOG0276|consen   53 VSEVPVRAAKFIARKNWIVTGSDDMQIRVFNYNTGEKVKTFE----------AHSDYIRSIAVHPTLPYVLTSSDDMTIK  122 (794)
T ss_pred             ecccchhhheeeeccceEEEecCCceEEEEecccceeeEEee----------ccccceeeeeecCCCCeEEecCCccEEE
Confidence            335688999999999999999999999999999999999984          3679999999999999999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      +||-+.+    -.+.++++||+..|.+|+|+|.|-+..||+   |-|+|||+|.+  .+..+..+|+||+.+|+||.+-+
T Consensus       123 lW~we~~----wa~~qtfeGH~HyVMqv~fnPkD~ntFaS~---sLDrTVKVWsl--gs~~~nfTl~gHekGVN~Vdyy~  193 (794)
T KOG0276|consen  123 LWDWENE----WACEQTFEGHEHYVMQVAFNPKDPNTFASA---SLDRTVKVWSL--GSPHPNFTLEGHEKGVNCVDYYT  193 (794)
T ss_pred             EeeccCc----eeeeeEEcCcceEEEEEEecCCCccceeee---eccccEEEEEc--CCCCCceeeeccccCcceEEecc
Confidence            9999864    257789999999999999999999999997   69999999998  45567899999999999999999


Q ss_pred             cch
Q 000080         2377 LLN 2379 (2389)
Q Consensus      2377 ~~~ 2379 (2389)
                      -|+
T Consensus       194 ~gd  196 (794)
T KOG0276|consen  194 GGD  196 (794)
T ss_pred             CCC
Confidence            885


No 36 
>KOG0284 consensus Polyadenylation factor I complex, subunit PFS2 [RNA processing and modification]
Probab=99.63  E-value=3.9e-16  Score=185.13  Aligned_cols=178  Identities=14%  Similarity=0.174  Sum_probs=146.5

Q ss_pred             cccCccccccccccccceeeccccccccccccccCCC--Cc--CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080         2179 DLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPA--TV--ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus      2179 ~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~a--tv--~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
                      +..+..||+-  -|.--++- +.|.+.++|+|..+..  .+  ++--|++++|||...+|||||.|..|||||.++|+|+
T Consensus       181 eaIRdlafSp--nDskF~t~-SdDg~ikiWdf~~~kee~vL~GHgwdVksvdWHP~kgLiasgskDnlVKlWDprSg~cl  257 (464)
T KOG0284|consen  181 EAIRDLAFSP--NDSKFLTC-SDDGTIKIWDFRMPKEERVLRGHGWDVKSVDWHPTKGLIASGSKDNLVKLWDPRSGSCL  257 (464)
T ss_pred             hhhheeccCC--CCceeEEe-cCCCeEEEEeccCCchhheeccCCCCcceeccCCccceeEEccCCceeEeecCCCcchh
Confidence            3445667754  33334444 7789999999973322  22  2345799999999999999999999999999999999


Q ss_pred             eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080         2255 ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus      2255 ~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
                      .|+.          +|.+.|.+|.|+|+|++|+|+|.|.++|+.|+++-     +.++++++|.+.|++++++|-.-.++
T Consensus       258 ~tlh----------~HKntVl~~~f~~n~N~Llt~skD~~~kv~DiR~m-----kEl~~~r~Hkkdv~~~~WhP~~~~lf  322 (464)
T KOG0284|consen  258 ATLH----------GHKNTVLAVKFNPNGNWLLTGSKDQSCKVFDIRTM-----KELFTYRGHKKDVTSLTWHPLNESLF  322 (464)
T ss_pred             hhhh----------hccceEEEEEEcCCCCeeEEccCCceEEEEehhHh-----HHHHHhhcchhhheeeccccccccce
Confidence            9983          58899999999999999999999999999999964     57899999999999999999877888


Q ss_pred             EEeecCCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEeecccch
Q 000080         2335 AAAGHSSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2335 ASAG~sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      +|||   .|+.|..|.+.  ..+.+. .-.+|.+.|++++.+|.|-
T Consensus       323 tsgg---~Dgsvvh~~v~--~~~p~~~i~~AHd~~iwsl~~hPlGh  363 (464)
T KOG0284|consen  323 TSGG---SDGSVVHWVVG--LEEPLGEIPPAHDGEIWSLAYHPLGH  363 (464)
T ss_pred             eecc---CCCceEEEecc--ccccccCCCcccccceeeeeccccce
Confidence            8865   89999999983  233343 3377999999999999985


No 37 
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.62  E-value=4.2e-15  Score=176.35  Aligned_cols=212  Identities=17%  Similarity=0.312  Sum_probs=144.5

Q ss_pred             CCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE
Q 000080           35 TAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA  114 (2389)
Q Consensus        35 ~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA  114 (2389)
                      .+|+-++=-+.++++  | ..+|-|+...-.|.|.-.++.-++..      -.++||..  +|..++||||   ..+++|
T Consensus       221 ~~htdEVWfl~FS~n--G-kyLAsaSkD~Taiiw~v~~d~~~kl~------~tlvgh~~--~V~yi~wSPD---dryLla  286 (519)
T KOG0293|consen  221 QDHTDEVWFLQFSHN--G-KYLASASKDSTAIIWIVVYDVHFKLK------KTLVGHSQ--PVSYIMWSPD---DRYLLA  286 (519)
T ss_pred             hhCCCcEEEEEEcCC--C-eeEeeccCCceEEEEEEecCcceeee------eeeecccC--ceEEEEECCC---CCeEEe
Confidence            467888888888988  8 58999999999999955555555544      66778866  9999999999   677776


Q ss_pred             e-cCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecc--eEEeeccC---CcEEEEEEeecc
Q 000080          115 A-SENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKN---TLWEIAWKFKEN  186 (2389)
Q Consensus       115 S-yDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~---s~Wecvwt~~~~  186 (2389)
                      + .|..+++|.-+.    |+.    .-...  +..+|-+.+|-|||.++++||.|  +.+|+...   +.|+-+      
T Consensus       287 Cg~~e~~~lwDv~t----gd~----~~~y~~~~~~S~~sc~W~pDg~~~V~Gs~dr~i~~wdlDgn~~~~W~gv------  352 (519)
T KOG0293|consen  287 CGFDEVLSLWDVDT----GDL----RHLYPSGLGFSVSSCAWCPDGFRFVTGSPDRTIIMWDLDGNILGNWEGV------  352 (519)
T ss_pred             cCchHheeeccCCc----chh----hhhcccCcCCCcceeEEccCCceeEecCCCCcEEEecCCcchhhccccc------
Confidence            5 688999998772    221    11111  35789999999999999999998  88998532   445532      


Q ss_pred             ccceEEEEeecCCCc-eEeeecccc---cccCC-----------------------------------------------
Q 000080          187 YPQNLVSATWSIEGP-SATAASMSQ---LDLLG-----------------------------------------------  215 (2389)
Q Consensus       187 ~~~~ivsvaWSpdG~-fATag~dik---f~~~~-----------------------------------------------  215 (2389)
                      ..+.+++++=++||+ +.+.+.|.+   |.++.                                               
T Consensus       353 r~~~v~dlait~Dgk~vl~v~~d~~i~l~~~e~~~dr~lise~~~its~~iS~d~k~~LvnL~~qei~LWDl~e~~lv~k  432 (519)
T KOG0293|consen  353 RDPKVHDLAITYDGKYVLLVTVDKKIRLYNREARVDRGLISEEQPITSFSISKDGKLALVNLQDQEIHLWDLEENKLVRK  432 (519)
T ss_pred             ccceeEEEEEcCCCcEEEEEecccceeeechhhhhhhccccccCceeEEEEcCCCcEEEEEcccCeeEEeecchhhHHHH
Confidence            334455555566666 333333222   11110                                               


Q ss_pred             ------------------------CCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEE
Q 000080          216 ------------------------PKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLL  271 (2389)
Q Consensus       216 ------------------------~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILA  271 (2389)
                                              +...+.-|+||-.-.+. ...+..+|+..||||+|+|.            ...++|
T Consensus       433 Y~Ghkq~~fiIrSCFgg~~~~fiaSGSED~kvyIWhr~sgk-ll~~LsGHs~~vNcVswNP~------------~p~m~A  499 (519)
T KOG0293|consen  433 YFGHKQGHFIIRSCFGGGNDKFIASGSEDSKVYIWHRISGK-LLAVLSGHSKTVNCVSWNPA------------DPEMFA  499 (519)
T ss_pred             hhcccccceEEEeccCCCCcceEEecCCCceEEEEEccCCc-eeEeecCCcceeeEEecCCC------------CHHHhh
Confidence                                    01111225555322222 22345899999999999995            455699


Q ss_pred             eeecCCeEEEEEeecC
Q 000080          272 TCCLDGTVRLWCEMDS  287 (2389)
Q Consensus       272 ScSdDgTVRLW~e~d~  287 (2389)
                      |+|||||||||...++
T Consensus       500 SasDDgtIRIWg~~~~  515 (519)
T KOG0293|consen  500 SASDDGTIRIWGPSDN  515 (519)
T ss_pred             ccCCCCeEEEecCCcc
Confidence            9999999999986543


No 38 
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.62  E-value=6.4e-15  Score=194.19  Aligned_cols=172  Identities=16%  Similarity=0.205  Sum_probs=138.6

Q ss_pred             ccceeeccccccccccccccC--CCCc--CceeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2193 GIGASALGWETQDDFEDYVDP--PATV--ENISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~d~--~atv--~ni~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      ..+|++ ++|.+.++|+....  ..++  +.-.|++++|+| ++.+|+|||.|++|++||+.+++++.++.   .     
T Consensus       546 ~~las~-~~Dg~v~lWd~~~~~~~~~~~~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~~~~~~~~---~-----  616 (793)
T PLN00181        546 SQVASS-NFEGVVQVWDVARSQLVTEMKEHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQGVSIGTIK---T-----  616 (793)
T ss_pred             CEEEEE-eCCCeEEEEECCCCeEEEEecCCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCCcEEEEEe---c-----
Confidence            356677 77888888876421  1111  123579999997 78999999999999999999999888874   1     


Q ss_pred             CCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2268 PYALASISALQFD-HYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2268 ~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                        | ..|.+++|+ ++|+.||+|+.||+|++||++++.    .++.++.+|...|.+++|.  +|+.|+|+   +.|++|
T Consensus       617 --~-~~v~~v~~~~~~g~~latgs~dg~I~iwD~~~~~----~~~~~~~~h~~~V~~v~f~--~~~~lvs~---s~D~~i  684 (793)
T PLN00181        617 --K-ANICCVQFPSESGRSLAFGSADHKVYYYDLRNPK----LPLCTMIGHSKTVSYVRFV--DSSTLVSS---STDNTL  684 (793)
T ss_pred             --C-CCeEEEEEeCCCCCEEEEEeCCCeEEEEECCCCC----ccceEecCCCCCEEEEEEe--CCCEEEEE---ECCCEE
Confidence              2 569999995 679999999999999999998752    3667888999999999997  46889887   489999


Q ss_pred             EEeeCCCC----CCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080         2347 VVWDTLAP----PTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2347 rLWD~l~~----tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      +|||+...    ..+.++++.+|.+.+.+++++++|+++.+-.
T Consensus       685 kiWd~~~~~~~~~~~~l~~~~gh~~~i~~v~~s~~~~~lasgs  727 (793)
T PLN00181        685 KLWDLSMSISGINETPLHSFMGHTNVKNFVGLSVSDGYIATGS  727 (793)
T ss_pred             EEEeCCCCccccCCcceEEEcCCCCCeeEEEEcCCCCEEEEEe
Confidence            99998422    2356889999999999999999999887643


No 39 
>KOG0273 consensus Beta-transducin family (WD-40 repeat) protein [Chromatin structure and dynamics]
Probab=99.60  E-value=6.3e-15  Score=177.26  Aligned_cols=140  Identities=19%  Similarity=0.248  Sum_probs=126.4

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC---------EEEEEe
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH---------RFASAA 2290 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~---------~LASgS 2290 (2389)
                      .+|.++.|+|.|.+|+|+|+|+|+|||..+++.+...|+          +|+..|+.+.+||+|.         .+|+++
T Consensus       360 g~V~alk~n~tg~LLaS~SdD~TlkiWs~~~~~~~~~l~----------~Hskei~t~~wsp~g~v~~n~~~~~~l~sas  429 (524)
T KOG0273|consen  360 GEVNALKWNPTGSLLASCSDDGTLKIWSMGQSNSVHDLQ----------AHSKEIYTIKWSPTGPVTSNPNMNLMLASAS  429 (524)
T ss_pred             CceEEEEECCCCceEEEecCCCeeEeeecCCCcchhhhh----------hhccceeeEeecCCCCccCCCcCCceEEEee
Confidence            477999999999999999999999999999998888875          4778999999999874         899999


Q ss_pred             CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080         2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
                      .|+||++||+..|     .|+.++..|+.+|++|+|+| +|++||+|   +.|+-|.||++  ++++.+++.+ -.+.|.
T Consensus       430 ~dstV~lwdv~~g-----v~i~~f~kH~~pVysvafS~-~g~ylAsG---s~dg~V~iws~--~~~~l~~s~~-~~~~If  497 (524)
T KOG0273|consen  430 FDSTVKLWDVESG-----VPIHTLMKHQEPVYSVAFSP-NGRYLASG---SLDGCVHIWST--KTGKLVKSYQ-GTGGIF  497 (524)
T ss_pred             cCCeEEEEEccCC-----ceeEeeccCCCceEEEEecC-CCcEEEec---CCCCeeEeccc--cchheeEeec-CCCeEE
Confidence            9999999999987     68899999999999999999 99999995   79999999998  6788888888 456789


Q ss_pred             EEeecccchhh
Q 000080         2371 LFLPLKLLNFA 2381 (2389)
Q Consensus      2371 svA~~~~~~~~ 2381 (2389)
                      .|..+..|+-+
T Consensus       498 el~Wn~~G~kl  508 (524)
T KOG0273|consen  498 ELCWNAAGDKL  508 (524)
T ss_pred             EEEEcCCCCEE
Confidence            99999998753


No 40 
>PLN00181 protein SPA1-RELATED; Provisional
Probab=99.59  E-value=1.7e-14  Score=190.30  Aligned_cols=171  Identities=12%  Similarity=0.117  Sum_probs=135.7

Q ss_pred             ccccceeeccccccccccccccCCC----------CcC-ceeEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080         2191 YAGIGASALGWETQDDFEDYVDPPA----------TVE-NISTRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~d~~a----------tv~-ni~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
                      .+.+.|+| +.|...++|++.....          .+. .-.|.+++|+|. +.+||||+.||+|+|||+.+++.+.++.
T Consensus       494 dg~~latg-g~D~~I~iwd~~~~~~~~~~~~~~~~~~~~~~~v~~l~~~~~~~~~las~~~Dg~v~lWd~~~~~~~~~~~  572 (793)
T PLN00181        494 DGEFFATA-GVNKKIKIFECESIIKDGRDIHYPVVELASRSKLSGICWNSYIKSQVASSNFEGVVQVWDVARSQLVTEMK  572 (793)
T ss_pred             CCCEEEEE-eCCCEEEEEECCcccccccccccceEEecccCceeeEEeccCCCCEEEEEeCCCeEEEEECCCCeEEEEec
Confidence            34578888 8888999997632110          011 124688999885 7899999999999999999998888773


Q ss_pred             ccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEe
Q 000080         2259 VLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus      2259 vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASA 2337 (2389)
                                +|.+.|++|+|+| +|+.||||+.||+|++||++++     ..+.++..| ..|.+++|++++|.+||+|
T Consensus       573 ----------~H~~~V~~l~~~p~~~~~L~Sgs~Dg~v~iWd~~~~-----~~~~~~~~~-~~v~~v~~~~~~g~~latg  636 (793)
T PLN00181        573 ----------EHEKRVWSIDYSSADPTLLASGSDDGSVKLWSINQG-----VSIGTIKTK-ANICCVQFPSESGRSLAFG  636 (793)
T ss_pred             ----------CCCCCEEEEEEcCCCCCEEEEEcCCCEEEEEECCCC-----cEEEEEecC-CCeEEEEEeCCCCCEEEEE
Confidence                      4678999999997 7999999999999999999986     345566544 5789999987689999996


Q ss_pred             ecCCCCCeEEEeeCCCCCCC-ceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2338 GHSSNGINVVVWDTLAPPTS-SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2338 G~sS~D~TVrLWD~l~~tg~-~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                         +.|++|++||+.  +.+ .+..+.+|...|+++++. +++..++-
T Consensus       637 ---s~dg~I~iwD~~--~~~~~~~~~~~h~~~V~~v~f~-~~~~lvs~  678 (793)
T PLN00181        637 ---SADHKVYYYDLR--NPKLPLCTMIGHSKTVSYVRFV-DSSTLVSS  678 (793)
T ss_pred             ---eCCCeEEEEECC--CCCccceEecCCCCCEEEEEEe-CCCEEEEE
Confidence               589999999984  333 478889999999999997 56665553


No 41 
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.59  E-value=3.2e-14  Score=153.90  Aligned_cols=144  Identities=17%  Similarity=0.270  Sum_probs=125.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      +|.+++|+|++++|++|+.|++|++||+.+++....+.          +|...+..+.|+|+|+.|++++.||+|++||+
T Consensus        11 ~i~~~~~~~~~~~l~~~~~~g~i~i~~~~~~~~~~~~~----------~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~   80 (289)
T cd00200          11 GVTCVAFSPDGKLLATGSGDGTIKVWDLETGELLRTLK----------GHTGPVRDVAASADGTYLASGSSDKTIRLWDL   80 (289)
T ss_pred             CEEEEEEcCCCCEEEEeecCcEEEEEEeeCCCcEEEEe----------cCCcceeEEEECCCCCEEEEEcCCCeEEEEEc
Confidence            46999999999999999999999999998887666653          35577899999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +++     +....+.+|...+.+++|+| ++++++++   +.|+.|++||+  .+++.+..+.+|.+.+.++++++++++
T Consensus        81 ~~~-----~~~~~~~~~~~~i~~~~~~~-~~~~~~~~---~~~~~i~~~~~--~~~~~~~~~~~~~~~i~~~~~~~~~~~  149 (289)
T cd00200          81 ETG-----ECVRTLTGHTSYVSSVAFSP-DGRILSSS---SRDKTIKVWDV--ETGKCLTTLRGHTDWVNSVAFSPDGTF  149 (289)
T ss_pred             Ccc-----cceEEEeccCCcEEEEEEcC-CCCEEEEe---cCCCeEEEEEC--CCcEEEEEeccCCCcEEEEEEcCcCCE
Confidence            975     35667788999999999999 78888875   36999999998  356778889999999999999999888


Q ss_pred             hhccc
Q 000080         2381 ALSKC 2385 (2389)
Q Consensus      2381 ~~s~~ 2385 (2389)
                      ++.-+
T Consensus       150 l~~~~  154 (289)
T cd00200         150 VASSS  154 (289)
T ss_pred             EEEEc
Confidence            77644


No 42 
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.59  E-value=6.3e-15  Score=166.12  Aligned_cols=113  Identities=20%  Similarity=0.269  Sum_probs=105.4

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|+++.|+-||++.++++.|.|||||+.-.|.+++||.          ||...|..++.+.|...||||+.|+.|.+||+
T Consensus        19 aV~avryN~dGnY~ltcGsdrtvrLWNp~rg~liktYs----------ghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV   88 (307)
T KOG0316|consen   19 AVRAVRYNVDGNYCLTCGSDRTVRLWNPLRGALIKTYS----------GHGHEVLDAALSSDNSKFASCGGDKAVQVWDV   88 (307)
T ss_pred             ceEEEEEccCCCEEEEcCCCceEEeecccccceeeeec----------CCCceeeeccccccccccccCCCCceEEEEEc
Confidence            57999999999999999999999999999999999994          56688999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      +||     +..+.+.||.+.|+.|+|+- +.+.++||   |.|.+||+||-.
T Consensus        89 ~TG-----kv~Rr~rgH~aqVNtV~fNe-esSVv~Sg---sfD~s~r~wDCR  131 (307)
T KOG0316|consen   89 NTG-----KVDRRFRGHLAQVNTVRFNE-ESSVVASG---SFDSSVRLWDCR  131 (307)
T ss_pred             ccC-----eeeeecccccceeeEEEecC-cceEEEec---cccceeEEEEcc
Confidence            998     57888999999999999998 88999986   689999999974


No 43 
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.58  E-value=1.2e-15  Score=176.04  Aligned_cols=164  Identities=17%  Similarity=0.196  Sum_probs=135.0

Q ss_pred             cceeeccccccccccccc------cCCCC-cC-----ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080         2194 IGASALGWETQDDFEDYV------DPPAT-VE-----NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~------d~~at-v~-----ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
                      -+++| +-|.-.++|.|.      |.... -+     .-.|.+++|+.|...||||+.||.|++|-+.+|+|++.|.  .
T Consensus       227 yLvsg-SvDGFiEVWny~~GKlrKDLkYQAqd~fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri~tG~ClRrFd--r  303 (508)
T KOG0275|consen  227 YLVSG-SVDGFIEVWNYTTGKLRKDLKYQAQDNFMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRIETGQCLRRFD--R  303 (508)
T ss_pred             eEeec-cccceeeeehhccchhhhhhhhhhhcceeecccceEEEeecccHHHhhccCcCCcEEEEEEecchHHHHhh--h
Confidence            35556 556667777774      11111 11     1378999999999999999999999999999999999885  2


Q ss_pred             CCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC
Q 000080         2262 AANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS 2341 (2389)
Q Consensus      2262 gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS 2341 (2389)
                             .|+..|+++.||.|+..+.|+|.|.|||+--+.+|     +++..+.||+..|+.+.|.+ ||..|.|+   |
T Consensus       304 -------AHtkGvt~l~FSrD~SqiLS~sfD~tvRiHGlKSG-----K~LKEfrGHsSyvn~a~ft~-dG~~iisa---S  367 (508)
T KOG0275|consen  304 -------AHTKGVTCLSFSRDNSQILSASFDQTVRIHGLKSG-----KCLKEFRGHSSYVNEATFTD-DGHHIISA---S  367 (508)
T ss_pred             -------hhccCeeEEEEccCcchhhcccccceEEEeccccc-----hhHHHhcCccccccceEEcC-CCCeEEEe---c
Confidence                   36788999999999999999999999999999987     57888899999999999999 99999997   6


Q ss_pred             CCCeEEEeeCCCCCCCceEEEE--eecCcEEEEeecccc
Q 000080         2342 NGINVVVWDTLAPPTSSRASIT--CHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2342 ~D~TVrLWD~l~~tg~~v~sL~--GH~~~V~svA~~~~~ 2378 (2389)
                      .|+|||+|+.  .+++|+.++.  +-+-.|.+|-+.|+.
T Consensus       368 sDgtvkvW~~--KtteC~~Tfk~~~~d~~vnsv~~~PKn  404 (508)
T KOG0275|consen  368 SDGTVKVWHG--KTTECLSTFKPLGTDYPVNSVILLPKN  404 (508)
T ss_pred             CCccEEEecC--cchhhhhhccCCCCcccceeEEEcCCC
Confidence            8999999997  5778887774  345566777777664


No 44 
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.58  E-value=1.2e-14  Score=168.13  Aligned_cols=171  Identities=13%  Similarity=0.126  Sum_probs=141.5

Q ss_pred             ccccceeecccccccccccc-ccCCC--C--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2191 YAGIGASALGWETQDDFEDY-VDPPA--T--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~-~d~~a--t--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      .+...|+| |+|-.+-+|.. -|-+.  .  .+...|..+.|.+|+..|+|+|.|++|+.||.++|++++.++       
T Consensus        58 ~gs~~aSg-G~Dr~I~LWnv~gdceN~~~lkgHsgAVM~l~~~~d~s~i~S~gtDk~v~~wD~~tG~~~rk~k-------  129 (338)
T KOG0265|consen   58 DGSCFASG-GSDRAIVLWNVYGDCENFWVLKGHSGAVMELHGMRDGSHILSCGTDKTVRGWDAETGKRIRKHK-------  129 (338)
T ss_pred             CCCeEeec-CCcceEEEEeccccccceeeeccccceeEeeeeccCCCEEEEecCCceEEEEecccceeeehhc-------
Confidence            66778888 88888888874 22221  1  233577999999999999999999999999999999998775       


Q ss_pred             CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080         2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
                         +|...|.++.-+--| .++.||+.|||+||||+++.+     ++++++ -...+.+|+|.. ++..+.|||   -|+
T Consensus       130 ---~h~~~vNs~~p~rrg~~lv~SgsdD~t~kl~D~R~k~-----~~~t~~-~kyqltAv~f~d-~s~qv~sgg---Idn  196 (338)
T KOG0265|consen  130 ---GHTSFVNSLDPSRRGPQLVCSGSDDGTLKLWDIRKKE-----AIKTFE-NKYQLTAVGFKD-TSDQVISGG---IDN  196 (338)
T ss_pred             ---cccceeeecCccccCCeEEEecCCCceEEEEeecccc-----hhhccc-cceeEEEEEecc-cccceeecc---ccC
Confidence               577999999955556 688999999999999999752     444443 246788999998 778888886   899


Q ss_pred             eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      .||+||+.  .+.+++.+.||.+.|+.++.++.|.+.||.
T Consensus       197 ~ikvWd~r--~~d~~~~lsGh~DtIt~lsls~~gs~llsn  234 (338)
T KOG0265|consen  197 DIKVWDLR--KNDGLYTLSGHADTITGLSLSRYGSFLLSN  234 (338)
T ss_pred             ceeeeccc--cCcceEEeecccCceeeEEeccCCCccccc
Confidence            99999984  567899999999999999999999999985


No 45 
>cd00200 WD40 WD40 domain, found in a number of eukaryotic proteins that cover a wide variety of functions including adaptor/regulatory modules in signal transduction, pre-mRNA processing and cytoskeleton assembly; typically contains a GH dipeptide 11-24 residues from its N-terminus and the WD dipeptide at its C-terminus and is 40 residues long, hence the name WD40; between GH and WD lies a conserved core; serves as a stable propeller-like platform to which proteins can bind either stably or reversibly; forms a propeller-like structure with several blades where each blade is composed of a four-stranded anti-parallel b-sheet; instances with few detectable copies are hypothesized to form larger structures by dimerization; each WD40 sequence repeat forms the first three strands of one blade and the last strand in the next blade; the last C-terminal WD40 repeat completes the blade structure of the first WD40 repeat to create the closed ring propeller-structure; residues on the top and botto
Probab=99.57  E-value=7.3e-14  Score=151.09  Aligned_cols=168  Identities=19%  Similarity=0.246  Sum_probs=133.4

Q ss_pred             cceeeccccccccccccccC--CCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCC
Q 000080         2194 IGASALGWETQDDFEDYVDP--PAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPY 2269 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~d~--~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~G 2269 (2389)
                      ..+.+ +.+....+|++...  ...  .+...+..+.|+|++++|++++.|++|++||+.+++.+..+.          +
T Consensus        23 ~l~~~-~~~g~i~i~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~~~~~~~i~i~~~~~~~~~~~~~----------~   91 (289)
T cd00200          23 LLATG-SGDGTIKVWDLETGELLRTLKGHTGPVRDVAASADGTYLASGSSDKTIRLWDLETGECVRTLT----------G   91 (289)
T ss_pred             EEEEe-ecCcEEEEEEeeCCCcEEEEecCCcceeEEEECCCCCEEEEEcCCCeEEEEEcCcccceEEEe----------c
Confidence            34444 44555555554321  011  122345789999999999999999999999999887777763          3


Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      |...|.+++|+|+++.+++++.||.|++||++++     ++...+.+|...+.+++|+| ++.+|+++   +.|++|++|
T Consensus        92 ~~~~i~~~~~~~~~~~~~~~~~~~~i~~~~~~~~-----~~~~~~~~~~~~i~~~~~~~-~~~~l~~~---~~~~~i~i~  162 (289)
T cd00200          92 HTSYVSSVAFSPDGRILSSSSRDKTIKVWDVETG-----KCLTTLRGHTDWVNSVAFSP-DGTFVASS---SQDGTIKLW  162 (289)
T ss_pred             cCCcEEEEEEcCCCCEEEEecCCCeEEEEECCCc-----EEEEEeccCCCcEEEEEEcC-cCCEEEEE---cCCCcEEEE
Confidence            5578999999999999999999999999999975     45667778999999999999 78999875   469999999


Q ss_pred             eCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2350 DTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      |+  .+++.++.+..|...+.+++.+|+++..+.
T Consensus       163 d~--~~~~~~~~~~~~~~~i~~~~~~~~~~~l~~  194 (289)
T cd00200         163 DL--RTGKCVATLTGHTGEVNSVAFSPDGEKLLS  194 (289)
T ss_pred             Ec--cccccceeEecCccccceEEECCCcCEEEE
Confidence            98  456778899999999999999999966543


No 46 
>PTZ00420 coronin; Provisional
Probab=99.57  E-value=7.2e-14  Score=177.91  Aligned_cols=153  Identities=12%  Similarity=0.159  Sum_probs=115.9

Q ss_pred             ccccceeeccccccccccccccC---C-------CCc--CceeEEEEEEcCCCCe-EEEEeCCCcEEEeecCCCceeeEe
Q 000080         2191 YAGIGASALGWETQDDFEDYVDP---P-------ATV--ENISTRAFSSHPLRPF-FLVGSSNTHIYLWEFGKDKATATY 2257 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~d~---~-------atv--~ni~VrsVAFsPdG~~-LASGS~DgTIRLWDl~tGk~l~Tl 2257 (2389)
                      ...++|+| +.|.+.++|+....   .       .++  +.-.|.+|+|||++.. |||||.|++|+|||+++++.+.++
T Consensus        86 ~~~lLASg-S~DgtIrIWDi~t~~~~~~~i~~p~~~L~gH~~~V~sVaf~P~g~~iLaSgS~DgtIrIWDl~tg~~~~~i  164 (568)
T PTZ00420         86 FSEILASG-SEDLTIRVWEIPHNDESVKEIKDPQCILKGHKKKISIIDWNPMNYYIMCSSGFDSFVNIWDIENEKRAFQI  164 (568)
T ss_pred             CCCEEEEE-eCCCeEEEEECCCCCccccccccceEEeecCCCcEEEEEECCCCCeEEEEEeCCCeEEEEECCCCcEEEEE
Confidence            34578888 88889999987421   0       111  1235799999999985 579999999999999999877665


Q ss_pred             cccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEE-----EEecCCCC
Q 000080         2258 GVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDV-----SYITSSGS 2332 (2389)
Q Consensus      2258 ~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sV-----AFSP~DGs 2332 (2389)
                      .           |...|.+++|+|||+.||+++.|++|+|||++++     +.+.++.+|.+.+...     .|++ ++.
T Consensus       165 ~-----------~~~~V~SlswspdG~lLat~s~D~~IrIwD~Rsg-----~~i~tl~gH~g~~~s~~v~~~~fs~-d~~  227 (568)
T PTZ00420        165 N-----------MPKKLSSLKWNIKGNLLSGTCVGKHMHIIDPRKQ-----EIASSFHIHDGGKNTKNIWIDGLGG-DDN  227 (568)
T ss_pred             e-----------cCCcEEEEEECCCCCEEEEEecCCEEEEEECCCC-----cEEEEEecccCCceeEEEEeeeEcC-CCC
Confidence            2           2356999999999999999999999999999986     3567888998865443     3457 888


Q ss_pred             EEEEeecCC-CCCeEEEeeCCCCCCCceEEE
Q 000080         2333 VIAAAGHSS-NGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus      2333 lLASAG~sS-~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
                      +|+|+|++. .+++|+|||+. ..++.++.+
T Consensus       228 ~IlTtG~d~~~~R~VkLWDlr-~~~~pl~~~  257 (568)
T PTZ00420        228 YILSTGFSKNNMREMKLWDLK-NTTSALVTM  257 (568)
T ss_pred             EEEEEEcCCCCccEEEEEECC-CCCCceEEE
Confidence            999887432 23689999984 234555544


No 47 
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.56  E-value=2.6e-15  Score=186.57  Aligned_cols=166  Identities=19%  Similarity=0.292  Sum_probs=141.7

Q ss_pred             ceeeccccccccccccccCCCCc----CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080         2195 GASALGWETQDDFEDYVDPPATV----ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus      2195 ~Asg~~~d~~~~~~~~~d~~atv----~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
                      ++.| ||++-.-+|...++.+..    +.-+|.+|.|+++..+|++|+.||+||+||+..++.++|+.          ||
T Consensus        43 ~~~G-g~~~k~~L~~i~kp~~i~S~~~hespIeSl~f~~~E~LlaagsasgtiK~wDleeAk~vrtLt----------gh  111 (825)
T KOG0267|consen   43 LVTG-GEDEKVNLWAIGKPNAITSLTGHESPIESLTFDTSERLLAAGSASGTIKVWDLEEAKIVRTLT----------GH  111 (825)
T ss_pred             eccC-CCceeeccccccCCchhheeeccCCcceeeecCcchhhhcccccCCceeeeehhhhhhhhhhh----------cc
Confidence            4456 888888888877554432    22468999999999999999999999999999999999884          67


Q ss_pred             CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      ...+.+|+|+|-|.++|+||.|+-+++||++..|     +..++.+|...|+.++|+| +|+++|++|   +|.+|+|||
T Consensus       112 ~~~~~sv~f~P~~~~~a~gStdtd~~iwD~Rk~G-----c~~~~~s~~~vv~~l~lsP-~Gr~v~~g~---ed~tvki~d  182 (825)
T KOG0267|consen  112 LLNITSVDFHPYGEFFASGSTDTDLKIWDIRKKG-----CSHTYKSHTRVVDVLRLSP-DGRWVASGG---EDNTVKIWD  182 (825)
T ss_pred             ccCcceeeeccceEEeccccccccceehhhhccC-----ceeeecCCcceeEEEeecC-CCceeeccC---Ccceeeeec
Confidence            7889999999999999999999999999999643     5677788999999999999 999999975   899999999


Q ss_pred             CCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2351 TLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2351 ~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      .  +.|+....|.+|++.+.++-++|. +++|+
T Consensus       183 ~--~agk~~~ef~~~e~~v~sle~hp~-e~Lla  212 (825)
T KOG0267|consen  183 L--TAGKLSKEFKSHEGKVQSLEFHPL-EVLLA  212 (825)
T ss_pred             c--cccccccccccccccccccccCch-hhhhc
Confidence            7  567778999999999999998874 44443


No 48 
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.55  E-value=1.6e-14  Score=180.88  Aligned_cols=144  Identities=18%  Similarity=0.328  Sum_probs=118.0

Q ss_pred             EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeC
Q 000080         2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl 2300 (2389)
                      ..+.||+.-+ +|+|||+||+||+||++..+.+.|++          +.+..|+.|+|+|- |+.||++.+.|.+++||+
T Consensus       137 ~~ldfh~tep~iliSGSQDg~vK~~DlR~~~S~~t~~----------~nSESiRDV~fsp~~~~~F~s~~dsG~lqlWDl  206 (839)
T KOG0269|consen  137 NKLDFHSTEPNILISGSQDGTVKCWDLRSKKSKSTFR----------SNSESIRDVKFSPGYGNKFASIHDSGYLQLWDL  206 (839)
T ss_pred             eeeeeccCCccEEEecCCCceEEEEeeeccccccccc----------ccchhhhceeeccCCCceEEEecCCceEEEeec
Confidence            6779999876 79999999999999999999988886          35688999999986 799999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +...    ++...+.+|.+.|.++.|+| ++.+|||||   .|++|||||+..+-.+...+++ -...|.+|..-|.-..
T Consensus       207 Rqp~----r~~~k~~AH~GpV~c~nwhP-nr~~lATGG---RDK~vkiWd~t~~~~~~~~tIn-Tiapv~rVkWRP~~~~  277 (839)
T KOG0269|consen  207 RQPD----RCEKKLTAHNGPVLCLNWHP-NREWLATGG---RDKMVKIWDMTDSRAKPKHTIN-TIAPVGRVKWRPARSY  277 (839)
T ss_pred             cCch----hHHHHhhcccCceEEEeecC-CCceeeecC---CCccEEEEeccCCCccceeEEe-ecceeeeeeeccCccc
Confidence            9864    68889999999999999999 999999975   9999999998422223344443 3345667777666555


Q ss_pred             hhccc
Q 000080         2381 ALSKC 2385 (2389)
Q Consensus      2381 ~~s~~ 2385 (2389)
                      -|--|
T Consensus       278 hLAtc  282 (839)
T KOG0269|consen  278 HLATC  282 (839)
T ss_pred             hhhhh
Confidence            44444


No 49 
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.55  E-value=2.6e-14  Score=177.55  Aligned_cols=164  Identities=18%  Similarity=0.246  Sum_probs=136.7

Q ss_pred             cccccceeeccccccccccccccCCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2190 GYAGIGASALGWETQDDFEDYVDPPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2190 g~~~~~Asg~~~d~~~~~~~~~d~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      |.++.+.|| +||.+.++|...+....+.  .-+|++|++=|++ .++|||.|.+||+|.=  |++++||.         
T Consensus       110 ~~~~~~iSg-SWD~TakvW~~~~l~~~l~gH~asVWAv~~l~e~-~~vTgsaDKtIklWk~--~~~l~tf~---------  176 (745)
T KOG0301|consen  110 GEDGTLISG-SWDSTAKVWRIGELVYSLQGHTASVWAVASLPEN-TYVTGSADKTIKLWKG--GTLLKTFS---------  176 (745)
T ss_pred             CCcCceEec-ccccceEEecchhhhcccCCcchheeeeeecCCC-cEEeccCcceeeeccC--Cchhhhhc---------
Confidence            345567889 9999999998754444333  2577999999988 8999999999999994  78899984         


Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                       ||++-|+.+++=|++ .|+|++.||.||+||+ +|     ..+..+.||+..|++++..+ +++.|+|+|   +|+|+|
T Consensus       177 -gHtD~VRgL~vl~~~-~flScsNDg~Ir~w~~-~g-----e~l~~~~ghtn~vYsis~~~-~~~~Ivs~g---EDrtlr  244 (745)
T KOG0301|consen  177 -GHTDCVRGLAVLDDS-HFLSCSNDGSIRLWDL-DG-----EVLLEMHGHTNFVYSISMAL-SDGLIVSTG---EDRTLR  244 (745)
T ss_pred             -cchhheeeeEEecCC-CeEeecCCceEEEEec-cC-----ceeeeeeccceEEEEEEecC-CCCeEEEec---CCceEE
Confidence             688999999999985 5899999999999999 44     36788899999999999887 678888875   999999


Q ss_pred             EeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      ||+.    +.|+|.++--+..||++...+.||-++
T Consensus       245 iW~~----~e~~q~I~lPttsiWsa~~L~NgDIvv  275 (745)
T KOG0301|consen  245 IWKK----DECVQVITLPTTSIWSAKVLLNGDIVV  275 (745)
T ss_pred             Eeec----CceEEEEecCccceEEEEEeeCCCEEE
Confidence            9996    588999984444899999988887543


No 50 
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.54  E-value=4.9e-15  Score=172.68  Aligned_cols=166  Identities=14%  Similarity=0.125  Sum_probs=131.4

Q ss_pred             ccccceeeccccccccccccccCC--CCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC--
Q 000080         2191 YAGIGASALGWETQDDFEDYVDPP--ATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN-- 2264 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~d~~--atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~-- 2264 (2389)
                      .|+...|| .-|.++++|+..+..  ..+.  ..+|-.+.|  +.+.|+|||.|.||++||+.+|+++.||.   +|-  
T Consensus       206 DD~kiVSG-lrDnTikiWD~n~~~c~~~L~GHtGSVLCLqy--d~rviisGSSDsTvrvWDv~tge~l~tli---hHcea  279 (499)
T KOG0281|consen  206 DDEKIVSG-LRDNTIKIWDKNSLECLKILTGHTGSVLCLQY--DERVIVSGSSDSTVRVWDVNTGEPLNTLI---HHCEA  279 (499)
T ss_pred             cchhhhcc-cccCceEEeccccHHHHHhhhcCCCcEEeeec--cceEEEecCCCceEEEEeccCCchhhHHh---hhcce
Confidence            35567778 667788888764221  1111  134455544  56799999999999999999999987763   221  


Q ss_pred             ------------------------C--C--------CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080         2265 ------------------------V--P--------PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2265 ------------------------~--p--------~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
                                              |  |        .-||.+.|..|.|+.  ++++|||.|+|||+|++.|+     ..
T Consensus       280 VLhlrf~ng~mvtcSkDrsiaVWdm~sps~it~rrVLvGHrAaVNvVdfd~--kyIVsASgDRTikvW~~st~-----ef  352 (499)
T KOG0281|consen  280 VLHLRFSNGYMVTCSKDRSIAVWDMASPTDITLRRVLVGHRAAVNVVDFDD--KYIVSASGDRTIKVWSTSTC-----EF  352 (499)
T ss_pred             eEEEEEeCCEEEEecCCceeEEEeccCchHHHHHHHHhhhhhheeeecccc--ceEEEecCCceEEEEeccce-----ee
Confidence                                    0  0        568999999999965  49999999999999999987     57


Q ss_pred             ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      ++++.||...|.++.|.   |++++||   |.|+||||||+  ..|.|++-|+||+.-|+|+-|..+
T Consensus       353 vRtl~gHkRGIAClQYr---~rlvVSG---SSDntIRlwdi--~~G~cLRvLeGHEeLvRciRFd~k  411 (499)
T KOG0281|consen  353 VRTLNGHKRGIACLQYR---DRLVVSG---SSDNTIRLWDI--ECGACLRVLEGHEELVRCIRFDNK  411 (499)
T ss_pred             ehhhhcccccceehhcc---CeEEEec---CCCceEEEEec--cccHHHHHHhchHHhhhheeecCc
Confidence            89999999999888886   4888885   79999999998  678999999999999999988764


No 51 
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.54  E-value=4.4e-14  Score=171.01  Aligned_cols=143  Identities=19%  Similarity=0.212  Sum_probs=117.7

Q ss_pred             eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
                      +|+.+-|+|++. .+++||+|+.+++||+.++.-..++          .||+++|++.+|+|. ++.++|||-||+||||
T Consensus       112 pv~~~~f~~~d~t~l~s~sDd~v~k~~d~s~a~v~~~l----------~~htDYVR~g~~~~~~~hivvtGsYDg~vrl~  181 (487)
T KOG0310|consen  112 PVHVTKFSPQDNTMLVSGSDDKVVKYWDLSTAYVQAEL----------SGHTDYVRCGDISPANDHIVVTGSYDGKVRLW  181 (487)
T ss_pred             ceeEEEecccCCeEEEecCCCceEEEEEcCCcEEEEEe----------cCCcceeEeeccccCCCeEEEecCCCceEEEE
Confidence            347789999766 6899999999999999877743333          368899999999998 5799999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      |+++.+    .+..++ .|..+|.+|.|.| +|++|||||    ++.||+||+. ..++.+..+..|..-|+|+....++
T Consensus       182 DtR~~~----~~v~el-nhg~pVe~vl~lp-sgs~iasAg----Gn~vkVWDl~-~G~qll~~~~~H~KtVTcL~l~s~~  250 (487)
T KOG0310|consen  182 DTRSLT----SRVVEL-NHGCPVESVLALP-SGSLIASAG----GNSVKVWDLT-TGGQLLTSMFNHNKTVTCLRLASDS  250 (487)
T ss_pred             EeccCC----ceeEEe-cCCCceeeEEEcC-CCCEEEEcC----CCeEEEEEec-CCceehhhhhcccceEEEEEeecCC
Confidence            999853    355555 5999999999999 999999985    6789999984 2334456666699999999999998


Q ss_pred             hhhhcc
Q 000080         2379 NFALSK 2384 (2389)
Q Consensus      2379 ~~~~s~ 2384 (2389)
                      .+.||-
T Consensus       251 ~rLlS~  256 (487)
T KOG0310|consen  251 TRLLSG  256 (487)
T ss_pred             ceEeec
Confidence            777763


No 52 
>KOG0275 consensus Conserved WD40 repeat-containing protein [General function prediction only]
Probab=99.53  E-value=3.5e-15  Score=172.33  Aligned_cols=151  Identities=15%  Similarity=0.180  Sum_probs=129.1

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      ++.+..|+|||++|+|||-||-|.+||+-+|+..+.++-....+  ..-|.+.|.++.||.|...+|||+.||.||+|.+
T Consensus       215 h~EcA~FSPDgqyLvsgSvDGFiEVWny~~GKlrKDLkYQAqd~--fMMmd~aVlci~FSRDsEMlAsGsqDGkIKvWri  292 (508)
T KOG0275|consen  215 HVECARFSPDGQYLVSGSVDGFIEVWNYTTGKLRKDLKYQAQDN--FMMMDDAVLCISFSRDSEMLASGSQDGKIKVWRI  292 (508)
T ss_pred             chhheeeCCCCceEeeccccceeeeehhccchhhhhhhhhhhcc--eeecccceEEEeecccHHHhhccCcCCcEEEEEE
Confidence            34566899999999999999999999999999876654211122  2235688999999999999999999999999999


Q ss_pred             CCCCccCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2301 EVGGRSNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      ++|     .+++.+. +|+..|.++.||. |++.|.|+   |.|.||||--+  ..|+|++.+.||+.-|+...+.++|+
T Consensus       293 ~tG-----~ClRrFdrAHtkGvt~l~FSr-D~SqiLS~---sfD~tvRiHGl--KSGK~LKEfrGHsSyvn~a~ft~dG~  361 (508)
T KOG0275|consen  293 ETG-----QCLRRFDRAHTKGVTCLSFSR-DNSQILSA---SFDQTVRIHGL--KSGKCLKEFRGHSSYVNEATFTDDGH  361 (508)
T ss_pred             ecc-----hHHHHhhhhhccCeeEEEEcc-Ccchhhcc---cccceEEEecc--ccchhHHHhcCccccccceEEcCCCC
Confidence            998     3555554 7999999999999 77878886   58999999998  57899999999999999999999999


Q ss_pred             hhhcc
Q 000080         2380 FALSK 2384 (2389)
Q Consensus      2380 ~~~s~ 2384 (2389)
                      .++|.
T Consensus       362 ~iisa  366 (508)
T KOG0275|consen  362 HIISA  366 (508)
T ss_pred             eEEEe
Confidence            99874


No 53 
>KOG0318 consensus WD40 repeat stress protein/actin interacting protein [Cytoskeleton]
Probab=99.53  E-value=7.6e-14  Score=169.57  Aligned_cols=166  Identities=16%  Similarity=0.242  Sum_probs=129.9

Q ss_pred             eccccccccccccccCCCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEE
Q 000080         2198 ALGWETQDDFEDYVDPPATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISA 2276 (2389)
Q Consensus      2198 g~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~s 2276 (2389)
                      .|.||+.--+-++.-+.+     .|.+++|-|..| +++|||+|++|.+++=..-+-..+++          -|+..|++
T Consensus       131 ~F~~DSG~SvGei~GhSr-----~ins~~~KpsRPfRi~T~sdDn~v~ffeGPPFKFk~s~r----------~HskFV~~  195 (603)
T KOG0318|consen  131 VFLWDSGNSVGEITGHSR-----RINSVDFKPSRPFRIATGSDDNTVAFFEGPPFKFKSSFR----------EHSKFVNC  195 (603)
T ss_pred             EEEecCCCccceeeccce-----eEeeeeccCCCceEEEeccCCCeEEEeeCCCeeeeeccc----------ccccceee
Confidence            356666665555533333     347789999999 49999999999999943345556664          27799999


Q ss_pred             EEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC----
Q 000080         2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL---- 2352 (2389)
Q Consensus      2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l---- 2352 (2389)
                      |.|||||.+|||++.||+|.|+|=.+|+  .+..+..-.+|.+.|++++|+| |++.+||+   |.|+|+||||+.    
T Consensus       196 VRysPDG~~Fat~gsDgki~iyDGktge--~vg~l~~~~aHkGsIfalsWsP-Ds~~~~T~---SaDkt~KIWdVs~~sl  269 (603)
T KOG0318|consen  196 VRYSPDGSRFATAGSDGKIYIYDGKTGE--KVGELEDSDAHKGSIFALSWSP-DSTQFLTV---SADKTIKIWDVSTNSL  269 (603)
T ss_pred             EEECCCCCeEEEecCCccEEEEcCCCcc--EEEEecCCCCccccEEEEEECC-CCceEEEe---cCCceEEEEEeeccce
Confidence            9999999999999999999999999984  2233333458999999999999 99999998   699999999961    


Q ss_pred             -------------------------------------CCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2353 -------------------------------------APPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2353 -------------------------------------~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                                                           ......++.+.||...|++++.+++|..++|-
T Consensus       270 v~t~~~~~~v~dqqvG~lWqkd~lItVSl~G~in~ln~~d~~~~~~i~GHnK~ITaLtv~~d~~~i~Sg  338 (603)
T KOG0318|consen  270 VSTWPMGSTVEDQQVGCLWQKDHLITVSLSGTINYLNPSDPSVLKVISGHNKSITALTVSPDGKTIYSG  338 (603)
T ss_pred             EEEeecCCchhceEEEEEEeCCeEEEEEcCcEEEEecccCCChhheecccccceeEEEEcCCCCEEEee
Confidence                                                 01112245578899999999999999888763


No 54 
>KOG0291 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.52  E-value=6.3e-14  Score=174.94  Aligned_cols=144  Identities=19%  Similarity=0.233  Sum_probs=124.5

Q ss_pred             eEEEEEEcCCCCeEEEEeCC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +|.+++|+..|.+||-|+.- |.+-+|+|.+..-+  ++        +.||...++++++||||+++|+|++||.||+||
T Consensus       309 ~I~t~~~N~tGDWiA~g~~klgQLlVweWqsEsYV--lK--------QQgH~~~i~~l~YSpDgq~iaTG~eDgKVKvWn  378 (893)
T KOG0291|consen  309 KILTVSFNSTGDWIAFGCSKLGQLLVWEWQSESYV--LK--------QQGHSDRITSLAYSPDGQLIATGAEDGKVKVWN  378 (893)
T ss_pred             eeeEEEecccCCEEEEcCCccceEEEEEeecccee--ee--------ccccccceeeEEECCCCcEEEeccCCCcEEEEe
Confidence            56889999999999998866 89999999755433  33        246889999999999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC----------------------------
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT---------------------------- 2351 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~---------------------------- 2351 (2389)
                      ...|     .++.|+..|+..|..|.|+. +|+.|.|+   |-|||||.||+                            
T Consensus       379 ~~Sg-----fC~vTFteHts~Vt~v~f~~-~g~~llss---SLDGtVRAwDlkRYrNfRTft~P~p~QfscvavD~sGel  449 (893)
T KOG0291|consen  379 TQSG-----FCFVTFTEHTSGVTAVQFTA-RGNVLLSS---SLDGTVRAWDLKRYRNFRTFTSPEPIQFSCVAVDPSGEL  449 (893)
T ss_pred             ccCc-----eEEEEeccCCCceEEEEEEe-cCCEEEEe---ecCCeEEeeeecccceeeeecCCCceeeeEEEEcCCCCE
Confidence            9986     68999999999999999999 99999996   69999999996                            


Q ss_pred             --------------CCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2352 --------------LAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2352 --------------l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                                    ..++|+.+-.|.||+++|.++++++.|+-..|
T Consensus       450 V~AG~~d~F~IfvWS~qTGqllDiLsGHEgPVs~l~f~~~~~~LaS  495 (893)
T KOG0291|consen  450 VCAGAQDSFEIFVWSVQTGQLLDILSGHEGPVSGLSFSPDGSLLAS  495 (893)
T ss_pred             EEeeccceEEEEEEEeecCeeeehhcCCCCcceeeEEccccCeEEe
Confidence                          12566666778999999999999999985544


No 55 
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.52  E-value=1e-13  Score=157.86  Aligned_cols=146  Identities=20%  Similarity=0.207  Sum_probs=124.1

Q ss_pred             eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
                      .|.+|.+++. ++.++++|.|+||||||...++.++||.          ||..-|.+.+|||. ++.|||+|.|++++||
T Consensus       106 EV~Svdwn~~~r~~~ltsSWD~TiKLW~~~r~~Sv~Tf~----------gh~~~Iy~a~~sp~~~nlfas~Sgd~~l~lw  175 (311)
T KOG0277|consen  106 EVYSVDWNTVRRRIFLTSSWDGTIKLWDPNRPNSVQTFN----------GHNSCIYQAAFSPHIPNLFASASGDGTLRLW  175 (311)
T ss_pred             heEEeccccccceeEEeeccCCceEeecCCCCcceEeec----------CCccEEEEEecCCCCCCeEEEccCCceEEEE
Confidence            4588899995 5578888999999999999999999985          56799999999987 6999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      |++..|    ++ ..+..|+..+.+..|+.-+-.+|||||   .|++||.||+.. -...+..|.||.-.|+.|.+||--
T Consensus       176 dvr~~g----k~-~~i~ah~~Eil~cdw~ky~~~vl~Tg~---vd~~vr~wDir~-~r~pl~eL~gh~~AVRkvk~Sph~  246 (311)
T KOG0277|consen  176 DVRSPG----KF-MSIEAHNSEILCCDWSKYNHNVLATGG---VDNLVRGWDIRN-LRTPLFELNGHGLAVRKVKFSPHH  246 (311)
T ss_pred             EecCCC----ce-eEEEeccceeEeecccccCCcEEEecC---CCceEEEEehhh-ccccceeecCCceEEEEEecCcch
Confidence            999875    33 348899999999999977888999974   899999999842 224478899999999999999987


Q ss_pred             hhhhccc
Q 000080         2379 NFALSKC 2385 (2389)
Q Consensus      2379 ~~~~s~~ 2385 (2389)
                      .=.|-.|
T Consensus       247 ~~lLaSa  253 (311)
T KOG0277|consen  247 ASLLASA  253 (311)
T ss_pred             hhHhhhc
Confidence            6666554


No 56 
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.51  E-value=1.4e-13  Score=156.21  Aligned_cols=212  Identities=25%  Similarity=0.444  Sum_probs=163.2

Q ss_pred             CCCCCCcceeec-CCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-
Q 000080           36 APTRSTSTIDWL-PDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA-  113 (2389)
Q Consensus        36 ap~~~~~ai~wl-pD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa-  113 (2389)
                      +|.-.+-+.+|. |-+++  ++|.++=+.-||.|  .      +. ++-+.|.++...|...|.+|+|-|.  .-|.+| 
T Consensus        54 Gh~GPVwqv~wahPk~G~--iLAScsYDgkVIiW--k------e~-~g~w~k~~e~~~h~~SVNsV~waph--eygl~La  120 (299)
T KOG1332|consen   54 GHSGPVWKVAWAHPKFGT--ILASCSYDGKVIIW--K------EE-NGRWTKAYEHAAHSASVNSVAWAPH--EYGLLLA  120 (299)
T ss_pred             CCCCCeeEEeecccccCc--EeeEeecCceEEEE--e------cC-CCchhhhhhhhhhcccceeeccccc--ccceEEE
Confidence            455566788998 88866  89999999999999  2      22 3467788888777678999999995  234455 


Q ss_pred             -EecCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCC---C-----------CeEEEEecc--eEEeeccCC
Q 000080          114 -AASENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGS---G-----------DGIVAGGME--TVLWKKKNT  175 (2389)
Q Consensus       114 -ASyDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpd---G-----------~rLaSggdD--V~IW~~~~s  175 (2389)
                       ||+|++|+|...+.  + +  .|...-.. .|+--|.+++|.|.   |           +||+|||-|  |+||+..++
T Consensus       121 casSDG~vsvl~~~~--~-g--~w~t~ki~~aH~~GvnsVswapa~~~g~~~~~~~~~~~krlvSgGcDn~VkiW~~~~~  195 (299)
T KOG1332|consen  121 CASSDGKVSVLTYDS--S-G--GWTTSKIVFAHEIGVNSVSWAPASAPGSLVDQGPAAKVKRLVSGGCDNLVKIWKFDSD  195 (299)
T ss_pred             EeeCCCcEEEEEEcC--C-C--CccchhhhhccccccceeeecCcCCCccccccCcccccceeeccCCccceeeeecCCc
Confidence             46899999999882  1 1  35543333 48889999999998   7           889999998  999999999


Q ss_pred             cEEEEEEeeccccceEE-EEeecCC-Cc----eEeeecccccccCCCCCCCceeEEEeeCCCcccee--ecccCCCCeeE
Q 000080          176 LWEIAWKFKENYPQNLV-SATWSIE-GP----SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK--LELCHPQPVSM  247 (2389)
Q Consensus       176 ~Wecvwt~~~~~~~~iv-svaWSpd-G~----fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~--ve~aH~qdVn~  247 (2389)
                      .|+...++  +.|...| +|+|+|. |.    +|||+.|.+            |+||-.+++.+-..  +...-+..|..
T Consensus       196 ~w~~e~~l--~~H~dwVRDVAwaP~~gl~~s~iAS~SqDg~------------viIwt~~~e~e~wk~tll~~f~~~~w~  261 (299)
T KOG1332|consen  196 SWKLERTL--EGHKDWVRDVAWAPSVGLPKSTIASCSQDGT------------VIIWTKDEEYEPWKKTLLEEFPDVVWR  261 (299)
T ss_pred             chhhhhhh--hhcchhhhhhhhccccCCCceeeEEecCCCc------------EEEEEecCccCcccccccccCCcceEE
Confidence            99988764  3445555 9999996 43    999999865            66676655544333  33445688999


Q ss_pred             EEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccc
Q 000080          248 VQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRK  292 (2389)
Q Consensus       248 V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk  292 (2389)
                      ++|+++             .|+|+-++.|+-|.||+|.-.|+-++
T Consensus       262 vSWS~s-------------Gn~LaVs~GdNkvtlwke~~~Gkw~~  293 (299)
T KOG1332|consen  262 VSWSLS-------------GNILAVSGGDNKVTLWKENVDGKWEE  293 (299)
T ss_pred             EEEecc-------------ccEEEEecCCcEEEEEEeCCCCcEEE
Confidence            999993             68899999999999999998887754


No 57 
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.51  E-value=1.7e-13  Score=169.38  Aligned_cols=177  Identities=13%  Similarity=0.150  Sum_probs=142.5

Q ss_pred             cceeeccccccccccccccCC----CCc--CceeEEEEEE-cCCCCeEEEEeCCCcEEEeecCCC--ceeeEecccCCCC
Q 000080         2194 IGASALGWETQDDFEDYVDPP----ATV--ENISTRAFSS-HPLRPFFLVGSSNTHIYLWEFGKD--KATATYGVLPAAN 2264 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~d~~----atv--~ni~VrsVAF-sPdG~~LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~ 2264 (2389)
                      .+.|. +=|++.++|....-.    .++  +.-+|.+++. -++...+||||-|+.|.|||+.+|  +.+.++...+...
T Consensus        87 tlIS~-SsDtTVK~W~~~~~~~~c~stir~H~DYVkcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~s  165 (735)
T KOG0308|consen   87 TLISA-SSDTTVKVWNAHKDNTFCMSTIRTHKDYVKCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNS  165 (735)
T ss_pred             ceEEe-cCCceEEEeecccCcchhHhhhhcccchheeeeecccCceeEEecCCCccEEEEEccCcchhhhhhcccccccc
Confidence            45666 668888888763221    111  1125699999 899999999999999999999988  4555554322221


Q ss_pred             CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080         2265 VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus      2265 ~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
                       ..-||...|+++|-+|.|..|++|+..+-+|+||.++.     +.+..++||+..|+.+-.++ ||+.+.||   |.|+
T Consensus       166 -l~sG~k~siYSLA~N~t~t~ivsGgtek~lr~wDprt~-----~kimkLrGHTdNVr~ll~~d-DGt~~ls~---sSDg  235 (735)
T KOG0308|consen  166 -LGSGPKDSIYSLAMNQTGTIIVSGGTEKDLRLWDPRTC-----KKIMKLRGHTDNVRVLLVND-DGTRLLSA---SSDG  235 (735)
T ss_pred             -CCCCCccceeeeecCCcceEEEecCcccceEEeccccc-----cceeeeeccccceEEEEEcC-CCCeEeec---CCCc
Confidence             12388899999999999999999999999999999996     45778899999999999998 99999997   5899


Q ss_pred             eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      ||||||+  ...+|++++.-|..+||++.-+|+..-.-|
T Consensus       236 tIrlWdL--gqQrCl~T~~vH~e~VWaL~~~~sf~~vYs  272 (735)
T KOG0308|consen  236 TIRLWDL--GQQRCLATYIVHKEGVWALQSSPSFTHVYS  272 (735)
T ss_pred             eEEeeec--cccceeeeEEeccCceEEEeeCCCcceEEe
Confidence            9999998  467899999999999999998887654433


No 58 
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.51  E-value=5.2e-14  Score=178.44  Aligned_cols=153  Identities=13%  Similarity=0.079  Sum_probs=120.0

Q ss_pred             CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--------------------------------ceeeEe-----ccc
Q 000080         2218 ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--------------------------------KATATY-----GVL 2260 (2389)
Q Consensus      2218 ~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--------------------------------k~l~Tl-----~vl 2260 (2389)
                      +...|+++.||+||+||||||.|+.||||.+...                                ..-++.     ...
T Consensus       266 h~gaIw~mKFS~DGKyLAsaGeD~virVWkVie~e~~~~~~~~~~~~~~~~~~~s~~~p~~s~~~~~~~~~s~~~~~~~s  345 (712)
T KOG0283|consen  266 HKGAIWAMKFSHDGKYLASAGEDGVIRVWKVIESERMRVAEGDSSCMYFEYNANSQIEPSTSSEEKISSRTSSSRKGSQS  345 (712)
T ss_pred             cCCcEEEEEeCCCCceeeecCCCceEEEEEEeccchhcccccccchhhhhhhhccccCccccccccccccccccccccCC
Confidence            3456799999999999999999999999998650                                000000     000


Q ss_pred             CC-----CCC-----C---CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEe
Q 000080         2261 PA-----ANV-----P---PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYI 2327 (2389)
Q Consensus      2261 ~g-----h~~-----p---~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFS 2327 (2389)
                      ++     ...     |   ..||.+.|-.+.+|-++ +|.|+|.|.|||||++...     .++..+. |...|++|+|+
T Consensus       346 ~~~~~p~~~f~f~ekP~~ef~GHt~DILDlSWSKn~-fLLSSSMDKTVRLWh~~~~-----~CL~~F~-HndfVTcVaFn  418 (712)
T KOG0283|consen  346 PCVLLPLKAFVFSEKPFCEFKGHTADILDLSWSKNN-FLLSSSMDKTVRLWHPGRK-----ECLKVFS-HNDFVTCVAFN  418 (712)
T ss_pred             ccccCCCccccccccchhhhhccchhheecccccCC-eeEeccccccEEeecCCCc-----ceeeEEe-cCCeeEEEEec
Confidence            11     000     0   56999999999999885 8999999999999999864     4566654 99999999999


Q ss_pred             cCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2328 TSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2328 P~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      |-|.++++||   |-|+.||||++  +..+-+...+.| .-|+++++.|+|..|+=
T Consensus       419 PvDDryFiSG---SLD~KvRiWsI--~d~~Vv~W~Dl~-~lITAvcy~PdGk~avI  468 (712)
T KOG0283|consen  419 PVDDRYFISG---SLDGKVRLWSI--SDKKVVDWNDLR-DLITAVCYSPDGKGAVI  468 (712)
T ss_pred             ccCCCcEeec---ccccceEEeec--CcCeeEeehhhh-hhheeEEeccCCceEEE
Confidence            9999999995   79999999998  333445666666 78999999999999874


No 59 
>KOG0267 consensus Microtubule severing protein katanin p80 subunit B (contains WD40 repeats) [Cell cycle control, cell division, chromosome partitioning]
Probab=99.51  E-value=1.5e-14  Score=179.85  Aligned_cols=162  Identities=20%  Similarity=0.252  Sum_probs=134.8

Q ss_pred             cccccccccccCC--CC----cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2202 ETQDDFEDYVDPP--AT----VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2202 d~~~~~~~~~d~~--at----v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      +.+.++|+.....  +|    ..|+  -+|+|||-|.+.|+||.|+.+++||.+..-|..+|.          ||...|.
T Consensus        91 sgtiK~wDleeAk~vrtLtgh~~~~--~sv~f~P~~~~~a~gStdtd~~iwD~Rk~Gc~~~~~----------s~~~vv~  158 (825)
T KOG0267|consen   91 SGTIKVWDLEEAKIVRTLTGHLLNI--TSVDFHPYGEFFASGSTDTDLKIWDIRKKGCSHTYK----------SHTRVVD  158 (825)
T ss_pred             CCceeeeehhhhhhhhhhhccccCc--ceeeeccceEEeccccccccceehhhhccCceeeec----------CCcceeE
Confidence            3467777764222  23    3344  788999999999999999999999998788999985          4678899


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      .++|+|||+++|+|++|++|++||+..|     +....+.+|+..+.++.|+| ..-++|+|   |.|+||++||+  .+
T Consensus       159 ~l~lsP~Gr~v~~g~ed~tvki~d~~ag-----k~~~ef~~~e~~v~sle~hp-~e~Lla~G---s~d~tv~f~dl--et  227 (825)
T KOG0267|consen  159 VLRLSPDGRWVASGGEDNTVKIWDLTAG-----KLSKEFKSHEGKVQSLEFHP-LEVLLAPG---SSDRTVRFWDL--ET  227 (825)
T ss_pred             EEeecCCCceeeccCCcceeeeeccccc-----ccccccccccccccccccCc-hhhhhccC---CCCceeeeecc--ce
Confidence            9999999999999999999999999886     35667788999999999999 65777775   68999999998  34


Q ss_pred             CCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080         2356 TSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus      2356 g~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
                      -..+-+......+|.|+++.++|..+++-|.
T Consensus       228 fe~I~s~~~~~~~v~~~~fn~~~~~~~~G~q  258 (825)
T KOG0267|consen  228 FEVISSGKPETDGVRSLAFNPDGKIVLSGEQ  258 (825)
T ss_pred             eEEeeccCCccCCceeeeecCCceeeecCch
Confidence            4556667777999999999999999988764


No 60 
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=99.49  E-value=1.7e-13  Score=170.22  Aligned_cols=155  Identities=16%  Similarity=0.202  Sum_probs=130.6

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC---------------------------------CC-
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN---------------------------------VP- 2266 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~---------------------------------~p- 2266 (2389)
                      .|.+|.|+++|.+||.|-.+|+|.|||..+.+.++++..  .|.                                 +. 
T Consensus       219 ~vtSv~ws~~G~~LavG~~~g~v~iwD~~~~k~~~~~~~--~h~~rvg~laW~~~~lssGsr~~~I~~~dvR~~~~~~~~  296 (484)
T KOG0305|consen  219 LVTSVKWSPDGSHLAVGTSDGTVQIWDVKEQKKTRTLRG--SHASRVGSLAWNSSVLSSGSRDGKILNHDVRISQHVVST  296 (484)
T ss_pred             ceEEEEECCCCCEEEEeecCCeEEEEehhhccccccccC--CcCceeEEEeccCceEEEecCCCcEEEEEEecchhhhhh
Confidence            469999999999999999999999999988887777642  132                                 11 


Q ss_pred             CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      ..||...|..+++++||++||||+.|+.|.|||....     .+..++..|...|..++|.|-...+||||| |+.|++|
T Consensus       297 ~~~H~qeVCgLkws~d~~~lASGgnDN~~~Iwd~~~~-----~p~~~~~~H~aAVKA~awcP~q~~lLAsGG-Gs~D~~i  370 (484)
T KOG0305|consen  297 LQGHRQEVCGLKWSPDGNQLASGGNDNVVFIWDGLSP-----EPKFTFTEHTAAVKALAWCPWQSGLLATGG-GSADRCI  370 (484)
T ss_pred             hhcccceeeeeEECCCCCeeccCCCccceEeccCCCc-----cccEEEeccceeeeEeeeCCCccCceEEcC-CCcccEE
Confidence            5679999999999999999999999999999999543     688899999999999999999999999987 7899999


Q ss_pred             EEeeCC-----------------------------------------CCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2347 VVWDTL-----------------------------------------APPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2347 rLWD~l-----------------------------------------~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      ++||+.                                         .++-+.+..+.||+.+|-.+|-+|+|..+++
T Consensus       371 ~fwn~~~g~~i~~vdtgsQVcsL~Wsk~~kEi~sthG~s~n~i~lw~~ps~~~~~~l~gH~~RVl~la~SPdg~~i~t  448 (484)
T KOG0305|consen  371 KFWNTNTGARIDSVDTGSQVCSLIWSKKYKELLSTHGYSENQITLWKYPSMKLVAELLGHTSRVLYLALSPDGETIVT  448 (484)
T ss_pred             EEEEcCCCcEecccccCCceeeEEEcCCCCEEEEecCCCCCcEEEEeccccceeeeecCCcceeEEEEECCCCCEEEE
Confidence            999972                                         0111234557889999999999999888765


No 61 
>KOG0265 consensus U5 snRNP-specific protein-like factor and related proteins [RNA processing and modification]
Probab=99.48  E-value=2e-13  Score=158.34  Aligned_cols=172  Identities=21%  Similarity=0.237  Sum_probs=143.6

Q ss_pred             cceeeccccccccccccc--cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080         2194 IGASALGWETQDDFEDYV--DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~--d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
                      |..|| ..|.|.++|+..  +...+.++ -.+.+|.|..++..+.||+-|+.|++||++++..+.++.          ||
T Consensus       147 lv~Sg-sdD~t~kl~D~R~k~~~~t~~~kyqltAv~f~d~s~qv~sggIdn~ikvWd~r~~d~~~~ls----------Gh  215 (338)
T KOG0265|consen  147 LVCSG-SDDGTLKLWDIRKKEAIKTFENKYQLTAVGFKDTSDQVISGGIDNDIKVWDLRKNDGLYTLS----------GH  215 (338)
T ss_pred             EEEec-CCCceEEEEeecccchhhccccceeEEEEEecccccceeeccccCceeeeccccCcceEEee----------cc
Confidence            56677 788888888875  44456654 467999999999999999999999999999999998885          67


Q ss_pred             CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      .+.|+.+..||+|.++.|-+.|+||++||++-.. ...+++.-++||..    ....++++| +++.+.+ |  |.|+.|
T Consensus       216 ~DtIt~lsls~~gs~llsnsMd~tvrvwd~rp~~-p~~R~v~if~g~~hnfeknlL~cswsp-~~~~i~a-g--s~dr~v  290 (338)
T KOG0265|consen  216 ADTITGLSLSRYGSFLLSNSMDNTVRVWDVRPFA-PSQRCVKIFQGHIHNFEKNLLKCSWSP-NGTKITA-G--SADRFV  290 (338)
T ss_pred             cCceeeEEeccCCCccccccccceEEEEEecccC-CCCceEEEeecchhhhhhhcceeeccC-CCCcccc-c--cccceE
Confidence            8999999999999999999999999999998642 22245666677553    334789999 8888865 4  799999


Q ss_pred             EEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      .+||+.  ...++..|.||.+-|.+++++|.-.++||
T Consensus       291 yvwd~~--~r~~lyklpGh~gsvn~~~Fhp~e~iils  325 (338)
T KOG0265|consen  291 YVWDTT--SRRILYKLPGHYGSVNEVDFHPTEPIILS  325 (338)
T ss_pred             EEeecc--cccEEEEcCCcceeEEEeeecCCCcEEEE
Confidence            999972  44678999999999999999999999887


No 62 
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.48  E-value=4.9e-13  Score=167.14  Aligned_cols=165  Identities=15%  Similarity=0.164  Sum_probs=138.4

Q ss_pred             cccccccccccc---cCCCCc------------C-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080         2200 GWETQDDFEDYV---DPPATV------------E-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus      2200 ~~d~~~~~~~~~---d~~atv------------~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
                      +-|++.++|+|.   +.+.|.            + .--|-++++||||++||.|=-|.||++|=+.+=+..-++.     
T Consensus       473 saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLel~ddvL~v~~Spdgk~LaVsLLdnTVkVyflDtlKFflsLY-----  547 (888)
T KOG0306|consen  473 SADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLELEDDVLCVSVSPDGKLLAVSLLDNTVKVYFLDTLKFFLSLY-----  547 (888)
T ss_pred             cCCcEEEEEeEEEEeccCcccceeeeeccceEEeccccEEEEEEcCCCcEEEEEeccCeEEEEEecceeeeeeec-----
Confidence            668888888884   322221            1 0146899999999999999999999999998776655542     


Q ss_pred             CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2264 NVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                           ||.=+|.++.+|||++.++|||.|.+||+|-+.=|     .+.+++-+|.+.|.+|.|-| .....-|+|   .|
T Consensus       548 -----GHkLPV~smDIS~DSklivTgSADKnVKiWGLdFG-----DCHKS~fAHdDSvm~V~F~P-~~~~FFt~g---KD  613 (888)
T KOG0306|consen  548 -----GHKLPVLSMDISPDSKLIVTGSADKNVKIWGLDFG-----DCHKSFFAHDDSVMSVQFLP-KTHLFFTCG---KD  613 (888)
T ss_pred             -----ccccceeEEeccCCcCeEEeccCCCceEEeccccc-----hhhhhhhcccCceeEEEEcc-cceeEEEec---Cc
Confidence                 57778999999999999999999999999999887     36788889999999999999 667777764   99


Q ss_pred             CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhccc
Q 000080         2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      +.||=||-  ..-.+++.|.||...|+|+|.+|.|+|.+|--
T Consensus       614 ~kvKqWDg--~kFe~iq~L~~H~~ev~cLav~~~G~~vvs~s  653 (888)
T KOG0306|consen  614 GKVKQWDG--EKFEEIQKLDGHHSEVWCLAVSPNGSFVVSSS  653 (888)
T ss_pred             ceEEeech--hhhhhheeeccchheeeeeEEcCCCCeEEecc
Confidence            99999995  24467999999999999999999999999854


No 63 
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.48  E-value=3.1e-13  Score=171.48  Aligned_cols=132  Identities=17%  Similarity=0.194  Sum_probs=116.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..|++++|..-+..|+|||.|.|+|+||..+|+|+.++.          ||...|+++..-+  ..+.+||.|.|||+||
T Consensus       250 g~V~~l~~~~~~~~lvsgS~D~t~rvWd~~sg~C~~~l~----------gh~stv~~~~~~~--~~~~sgs~D~tVkVW~  317 (537)
T KOG0274|consen  250 GGVWGLAFPSGGDKLVSGSTDKTERVWDCSTGECTHSLQ----------GHTSSVRCLTIDP--FLLVSGSRDNTVKVWD  317 (537)
T ss_pred             CCceeEEEecCCCEEEEEecCCcEEeEecCCCcEEEEec----------CCCceEEEEEccC--ceEeeccCCceEEEEe
Confidence            456999999988899999999999999999999999984          5778888887755  5899999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ++++     ..+.++.||...|++|.++   +.++++|   +.|++|++||+  .+++|+++|+||+++|.++.+..
T Consensus       318 v~n~-----~~l~l~~~h~~~V~~v~~~---~~~lvsg---s~d~~v~VW~~--~~~~cl~sl~gH~~~V~sl~~~~  381 (537)
T KOG0274|consen  318 VTNG-----ACLNLLRGHTGPVNCVQLD---EPLLVSG---SYDGTVKVWDP--RTGKCLKSLSGHTGRVYSLIVDS  381 (537)
T ss_pred             ccCc-----ceEEEeccccccEEEEEec---CCEEEEE---ecCceEEEEEh--hhceeeeeecCCcceEEEEEecC
Confidence            9986     4677888899999999998   4788875   68999999998  48999999999999999998776


No 64 
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.46  E-value=1.1e-12  Score=169.79  Aligned_cols=214  Identities=18%  Similarity=0.371  Sum_probs=155.1

Q ss_pred             CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccce--------------eeeeccCCCCCeeEEE
Q 000080           36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFR--------------QVFALSDNSLPVTSIS  101 (2389)
Q Consensus        36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~--------------Qviegh~d~~dVk~Va  101 (2389)
                      .|..+.+-+-|+||  | +.+|.|+.+.+|..|=-++     -..|+.|.              -++.+|+.  +|..|+
T Consensus        67 ~h~~sv~CVR~S~d--G-~~lAsGSDD~~v~iW~~~~-----~~~~~~fgs~g~~~~vE~wk~~~~l~~H~~--DV~Dv~  136 (942)
T KOG0973|consen   67 DHDGSVNCVRFSPD--G-SYLASGSDDRLVMIWERAE-----IGSGTVFGSTGGAKNVESWKVVSILRGHDS--DVLDVN  136 (942)
T ss_pred             cccCceeEEEECCC--C-CeEeeccCcceEEEeeecc-----cCCcccccccccccccceeeEEEEEecCCC--ccceec
Confidence            46677788889999  8 5999999999999991111     12345552              35566654  999999


Q ss_pred             EcCCCCCCCcEEE--ecCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc--eEEeeccCCc
Q 000080          102 WSPETPSIGQLAA--ASENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTL  176 (2389)
Q Consensus       102 WSPd~~~~GeIaA--SyDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~  176 (2389)
                      |+|+    +.++|  |+||+|-||..-      .  +.+..++ .|.+-|-.++|+|-|+++||=+||  ++||+.  +.
T Consensus       137 Wsp~----~~~lvS~s~DnsViiwn~~------t--F~~~~vl~~H~s~VKGvs~DP~Gky~ASqsdDrtikvwrt--~d  202 (942)
T KOG0973|consen  137 WSPD----DSLLVSVSLDNSVIIWNAK------T--FELLKVLRGHQSLVKGVSWDPIGKYFASQSDDRTLKVWRT--SD  202 (942)
T ss_pred             cCCC----ccEEEEecccceEEEEccc------c--ceeeeeeecccccccceEECCccCeeeeecCCceEEEEEc--cc
Confidence            9996    77776  479999999876      2  2455555 499999999999999999999999  999994  44


Q ss_pred             EEEEEEeecccc-----ceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEe
Q 000080          177 WEIAWKFKENYP-----QNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQW  250 (2389)
Q Consensus       177 Wecvwt~~~~~~-----~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W  250 (2389)
                      |.+.-++.....     -.+...+|||||. |||.-+...        ...++.|.+.+ .-...+-..+|..+|-+|+.
T Consensus       203 w~i~k~It~pf~~~~~~T~f~RlSWSPDG~~las~nA~n~--------~~~~~~IieR~-tWk~~~~LvGH~~p~evvrF  273 (942)
T KOG0973|consen  203 WGIEKSITKPFEESPLTTFFLRLSWSPDGHHLASPNAVNG--------GKSTIAIIERG-TWKVDKDLVGHSAPVEVVRF  273 (942)
T ss_pred             ceeeEeeccchhhCCCcceeeecccCCCcCeecchhhccC--------CcceeEEEecC-CceeeeeeecCCCceEEEEe
Confidence            776654321111     1344889999999 998877421        22334444332 22233446789999999999


Q ss_pred             ccCCCCC-CCCCCccccCc----eEEeeecCCeEEEEE
Q 000080          251 RPSTRRH-SPGDTKRSQRH----VLLTCCLDGTVRLWC  283 (2389)
Q Consensus       251 ~Ps~~~~-~~~Dgk~~~~n----ILAScSdDgTVRLW~  283 (2389)
                      +|. .|. ++.+|+....+    ++|++|.|+++-||.
T Consensus       274 nP~-lfe~~~~ng~~~~~~~~y~i~AvgSqDrSlSVW~  310 (942)
T KOG0973|consen  274 NPK-LFERNNKNGTSTQPNCYYCIAAVGSQDRSLSVWN  310 (942)
T ss_pred             ChH-HhccccccCCccCCCcceEEEEEecCCccEEEEe
Confidence            993 444 55666664454    999999999999999


No 65 
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.45  E-value=7.1e-13  Score=153.90  Aligned_cols=123  Identities=15%  Similarity=0.265  Sum_probs=98.5

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      +|.+|+||| ...++++||.|++||+||+.. |..+.+..         .-|.+.|-+|+||-||.++++|+.|+.+|+|
T Consensus        29 sIS~l~FSP~~~~~~~A~SWD~tVR~wevq~~g~~~~ka~---------~~~~~PvL~v~WsddgskVf~g~~Dk~~k~w   99 (347)
T KOG0647|consen   29 SISALAFSPQADNLLAAGSWDGTVRIWEVQNSGQLVPKAQ---------QSHDGPVLDVCWSDDGSKVFSGGCDKQAKLW   99 (347)
T ss_pred             chheeEeccccCceEEecccCCceEEEEEecCCcccchhh---------hccCCCeEEEEEccCCceEEeeccCCceEEE
Confidence            348899999 555777999999999999986 45444322         1256889999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCC-CCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSS-GSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~D-GslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      |+.++      ...+...|.+.|..+.|.++- -+.||||   |.|+|||.||+.  ..+.+.+++
T Consensus       100 DL~S~------Q~~~v~~Hd~pvkt~~wv~~~~~~cl~TG---SWDKTlKfWD~R--~~~pv~t~~  154 (347)
T KOG0647|consen  100 DLASG------QVSQVAAHDAPVKTCHWVPGMNYQCLVTG---SWDKTLKFWDTR--SSNPVATLQ  154 (347)
T ss_pred             EccCC------CeeeeeecccceeEEEEecCCCcceeEec---ccccceeecccC--CCCeeeeee
Confidence            99986      256677899999999999832 2378885   799999999995  334555554


No 66 
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.45  E-value=5.3e-13  Score=158.16  Aligned_cols=169  Identities=14%  Similarity=0.139  Sum_probs=136.6

Q ss_pred             cccccceeeccccccccccccc-cCCCCcC--------------------------c--eeEEEEEEcCCCCeEEEEeCC
Q 000080         2190 GYAGIGASALGWETQDDFEDYV-DPPATVE--------------------------N--ISTRAFSSHPLRPFFLVGSSN 2240 (2389)
Q Consensus      2190 g~~~~~Asg~~~d~~~~~~~~~-d~~atv~--------------------------n--i~VrsVAFsPdG~~LASGS~D 2240 (2389)
                      ++..+.+|| +||++..+|.+. ++..+++                          +  -+|.+|-|++ ...+.|+|+|
T Consensus       203 ~sgtr~~Sg-S~D~~lkiWs~~~~~~~~~E~~s~~rrk~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v~yS~SwD  280 (423)
T KOG0313|consen  203 SSGTRFCSG-SWDTMLKIWSVETDEEDELESSSNRRRKKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATVIYSVSWD  280 (423)
T ss_pred             CCCCeEEee-cccceeeecccCCCccccccccchhhhhhhhhhhcccccCceEEecccccceeeEEEcC-CCceEeeccc
Confidence            345567888 999999999842 1111111                          1  2789999999 6678999999


Q ss_pred             CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCC
Q 000080         2241 THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSH 2320 (2389)
Q Consensus      2241 gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~ 2320 (2389)
                      .|||.||+.+|+++.++..           .....+|..+|.-++||+||.|..+||||.++++  ..-+..++.||.+.
T Consensus       281 HTIk~WDletg~~~~~~~~-----------~ksl~~i~~~~~~~Ll~~gssdr~irl~DPR~~~--gs~v~~s~~gH~nw  347 (423)
T KOG0313|consen  281 HTIKVWDLETGGLKSTLTT-----------NKSLNCISYSPLSKLLASGSSDRHIRLWDPRTGD--GSVVSQSLIGHKNW  347 (423)
T ss_pred             ceEEEEEeecccceeeeec-----------CcceeEeecccccceeeecCCCCceeecCCCCCC--CceeEEeeecchhh
Confidence            9999999999999888741           2568999999999999999999999999999974  33466889999999


Q ss_pred             eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2321 AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2321 V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      |.+|-++|-+-..++|+   |.|+|+||||+. .+...+..+.+|...|-++.-.+.
T Consensus       348 Vssvkwsp~~~~~~~S~---S~D~t~klWDvR-S~k~plydI~~h~DKvl~vdW~~~  400 (423)
T KOG0313|consen  348 VSSVKWSPTNEFQLVSG---SYDNTVKLWDVR-STKAPLYDIAGHNDKVLSVDWNEG  400 (423)
T ss_pred             hhheecCCCCceEEEEE---ecCCeEEEEEec-cCCCcceeeccCCceEEEEeccCC
Confidence            99999999666677775   799999999995 344469999999999988876554


No 67 
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.45  E-value=1.3e-13  Score=166.66  Aligned_cols=173  Identities=13%  Similarity=0.209  Sum_probs=135.9

Q ss_pred             ccccccceeeccccccccccccccCCCCcC-----ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDPPATVE-----NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~-----ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
                      |=..-+++|+ |-|....+|++.+.-..+.     +-+|++++|+++|..++|+|.|++|||||+++|+++..|..  + 
T Consensus       224 p~~~hLlLS~-gmD~~vklW~vy~~~~~lrtf~gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlwDtETG~~~~~f~~--~-  299 (503)
T KOG0282|consen  224 PKKGHLLLSG-GMDGLVKLWNVYDDRRCLRTFKGHRKPVRDASFNNCGTSFLSASFDRFLKLWDTETGQVLSRFHL--D-  299 (503)
T ss_pred             cceeeEEEec-CCCceEEEEEEecCcceehhhhcchhhhhhhhccccCCeeeeeecceeeeeeccccceEEEEEec--C-
Confidence            4455667788 8888889998875323322     34779999999999999999999999999999999999851  1 


Q ss_pred             CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080         2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
                              ..+++|.|.||+ +.|.+|+.|+.|+.||++++     +.+..+..|-+.|.++.|.+ +|+..+|+   |+
T Consensus       300 --------~~~~cvkf~pd~~n~fl~G~sd~ki~~wDiRs~-----kvvqeYd~hLg~i~~i~F~~-~g~rFiss---SD  362 (503)
T KOG0282|consen  300 --------KVPTCVKFHPDNQNIFLVGGSDKKIRQWDIRSG-----KVVQEYDRHLGAILDITFVD-EGRRFISS---SD  362 (503)
T ss_pred             --------CCceeeecCCCCCcEEEEecCCCcEEEEeccch-----HHHHHHHhhhhheeeeEEcc-CCceEeee---cc
Confidence                    457999999999 99999999999999999987     46677778999999999999 88999986   79


Q ss_pred             CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      |++||||+...+ ...-....-+..-..|++.+|.|+|..-
T Consensus       363 dks~riWe~~~~-v~ik~i~~~~~hsmP~~~~~P~~~~~~a  402 (503)
T KOG0282|consen  363 DKSVRIWENRIP-VPIKNIADPEMHTMPCLTLHPNGKWFAA  402 (503)
T ss_pred             CccEEEEEcCCC-ccchhhcchhhccCcceecCCCCCeehh
Confidence            999999997322 1111112222223668888888887653


No 68 
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.45  E-value=7.7e-13  Score=156.63  Aligned_cols=158  Identities=22%  Similarity=0.325  Sum_probs=117.5

Q ss_pred             cccCCCccccCccccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCC
Q 000080         2172 SLARPGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGK 2250 (2389)
Q Consensus      2172 ~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~t 2250 (2389)
                      |+.+.++-++|--.++|          +-|+-..--|.+...+-+.+.-+|-.+.|||+-. .|||+|.||+|||||++.
T Consensus       220 Sp~~~g~LlsGDc~~~I----------~lw~~~~g~W~vd~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDiRs  289 (440)
T KOG0302|consen  220 SPIKTGRLLSGDCVKGI----------HLWEPSTGSWKVDQRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDIRS  289 (440)
T ss_pred             ccccccccccCccccce----------EeeeeccCceeecCccccccccchhhhccCCccCceEEeeecCceEEEEEecC
Confidence            44455555554444443          2344444445443333344445667889999865 799999999999999998


Q ss_pred             CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCC
Q 000080         2251 DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus      2251 Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
                      +....++.. .+       |.+.|+.|.||-+-.+||||++|||++|||+++-.  .-+|+.++.-|..+|++|.|+|.+
T Consensus       290 ~~~~~~~~~-kA-------h~sDVNVISWnr~~~lLasG~DdGt~~iwDLR~~~--~~~pVA~fk~Hk~pItsieW~p~e  359 (440)
T KOG0302|consen  290 GPKKAAVST-KA-------HNSDVNVISWNRREPLLASGGDDGTLSIWDLRQFK--SGQPVATFKYHKAPITSIEWHPHE  359 (440)
T ss_pred             CCccceeEe-ec-------cCCceeeEEccCCcceeeecCCCceEEEEEhhhcc--CCCcceeEEeccCCeeEEEecccc
Confidence            843333221 34       45789999999887899999999999999999852  227889999999999999999988


Q ss_pred             CCEEEEeecCCCCCeEEEeeCC
Q 000080         2331 GSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2331 GslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .+.||++   ++|.+|.|||+.
T Consensus       360 ~s~iaas---g~D~QitiWDls  378 (440)
T KOG0302|consen  360 DSVIAAS---GEDNQITIWDLS  378 (440)
T ss_pred             CceEEec---cCCCcEEEEEee
Confidence            8888876   489999999983


No 69 
>KOG0310 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.44  E-value=3.6e-13  Score=163.29  Aligned_cols=142  Identities=13%  Similarity=0.127  Sum_probs=120.5

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
                      |.+++|-.||++||.|...|.|+++|..+-..++.++          +|+++|..+.|+|++ ..|++||+|+.+++||+
T Consensus        71 v~s~~fR~DG~LlaaGD~sG~V~vfD~k~r~iLR~~~----------ah~apv~~~~f~~~d~t~l~s~sDd~v~k~~d~  140 (487)
T KOG0310|consen   71 VYSVDFRSDGRLLAAGDESGHVKVFDMKSRVILRQLY----------AHQAPVHVTKFSPQDNTMLVSGSDDKVVKYWDL  140 (487)
T ss_pred             eeEEEeecCCeEEEccCCcCcEEEeccccHHHHHHHh----------hccCceeEEEecccCCeEEEecCCCceEEEEEc
Confidence            3888999999999999999999999965534566664          367889999999986 68889999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      .++     .....+++|++.|++.+++|.++.+++||   |-|++||+||+...+ ..+.+|. |..+|-++-+.|.|-.
T Consensus       141 s~a-----~v~~~l~~htDYVR~g~~~~~~~hivvtG---sYDg~vrl~DtR~~~-~~v~eln-hg~pVe~vl~lpsgs~  210 (487)
T KOG0310|consen  141 STA-----YVQAELSGHTDYVRCGDISPANDHIVVTG---SYDGKVRLWDTRSLT-SRVVELN-HGCPVESVLALPSGSL  210 (487)
T ss_pred             CCc-----EEEEEecCCcceeEeeccccCCCeEEEec---CCCceEEEEEeccCC-ceeEEec-CCCceeeEEEcCCCCE
Confidence            986     23568899999999999999888899996   589999999996433 5577777 8999999999999876


Q ss_pred             hhc
Q 000080         2381 ALS 2383 (2389)
Q Consensus      2381 ~~s 2383 (2389)
                      +.|
T Consensus       211 ias  213 (487)
T KOG0310|consen  211 IAS  213 (487)
T ss_pred             EEE
Confidence            655


No 70 
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.43  E-value=8.3e-13  Score=160.21  Aligned_cols=182  Identities=14%  Similarity=0.124  Sum_probs=139.0

Q ss_pred             cceeeccccccccccccccCCCCcC---------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC
Q 000080         2194 IGASALGWETQDDFEDYVDPPATVE---------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN 2264 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~d~~atv~---------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~ 2264 (2389)
                      ..++| ++|-+.++|+|....++..         +-.|++++|+|+|..|+..|....++|.|- .|..+..+.  .|..
T Consensus       181 R~~sG-s~Dy~v~~wDf~gMdas~~~fr~l~P~E~h~i~sl~ys~Tg~~iLvvsg~aqakl~DR-dG~~~~e~~--KGDQ  256 (641)
T KOG0772|consen  181 RFVSG-SLDYTVKFWDFQGMDASMRSFRQLQPCETHQINSLQYSVTGDQILVVSGSAQAKLLDR-DGFEIVEFS--KGDQ  256 (641)
T ss_pred             eeeec-cccceEEEEecccccccchhhhccCcccccccceeeecCCCCeEEEEecCcceeEEcc-CCceeeeee--ccch
Confidence            45788 9999999999974444322         236799999999999998899999999994 676554331  2333


Q ss_pred             C-----CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceee--eecCCCeeEEEEecCCCCEEEE
Q 000080         2265 V-----PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESC--LCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus      2265 ~-----p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl--~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
                      +     -.-||.+.+++..|.|+. ..|.|+|.|||+||||++.. +++.+.+.+-  .|-.-.+.+.+|+| ||.+||+
T Consensus       257 YI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~DgtlRiWdv~~~-k~q~qVik~k~~~g~Rv~~tsC~~nr-dg~~iAa  334 (641)
T KOG0772|consen  257 YIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYDGTLRIWDVNNT-KSQLQVIKTKPAGGKRVPVTSCAWNR-DGKLIAA  334 (641)
T ss_pred             hhhhhhccCCceeeeeccccccCcccceEEecCCCcEEEEecCCc-hhheeEEeeccCCCcccCceeeecCC-Ccchhhh
Confidence            1     256899999999999997 69999999999999999875 3343444332  23334567899999 9999997


Q ss_pred             eecCCCCCeEEEeeCCCCCCCceEE-EEeecC--cEEEEeecccchhhhcc
Q 000080         2337 AGHSSNGINVVVWDTLAPPTSSRAS-ITCHEG--LYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2337 AG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~--~V~svA~~~~~~~~~s~ 2384 (2389)
                      |   ..||.|++||....+...... =+.|..  .|+||+||.+||..||.
T Consensus       335 g---c~DGSIQ~W~~~~~~v~p~~~vk~AH~~g~~Itsi~FS~dg~~LlSR  382 (641)
T KOG0772|consen  335 G---CLDGSIQIWDKGSRTVRPVMKVKDAHLPGQDITSISFSYDGNYLLSR  382 (641)
T ss_pred             c---ccCCceeeeecCCcccccceEeeeccCCCCceeEEEeccccchhhhc
Confidence            4   699999999974333333333 367888  99999999999999985


No 71 
>KOG0277 consensus Peroxisomal targeting signal type 2 receptor [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.43  E-value=1.3e-12  Score=149.14  Aligned_cols=141  Identities=13%  Similarity=0.165  Sum_probs=118.2

Q ss_pred             EEEEEEcCCCC-eEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080         2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
                      +..|+|+++-. .+++++.||++||||.... ..++.|+          -|...|.+|-.++- ++.+.++|.|+|||||
T Consensus        63 LfdV~Wse~~e~~~~~a~GDGSLrl~d~~~~s~Pi~~~k----------EH~~EV~Svdwn~~~r~~~ltsSWD~TiKLW  132 (311)
T KOG0277|consen   63 LFDVAWSENHENQVIAASGDGSLRLFDLTMPSKPIHKFK----------EHKREVYSVDWNTVRRRIFLTSSWDGTIKLW  132 (311)
T ss_pred             eeEeeecCCCcceEEEEecCceEEEeccCCCCcchhHHH----------hhhhheEEeccccccceeEEeeccCCceEee
Confidence            37889999854 7889999999999996544 3667775          26799999999986 5778888999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      +.+.+     +-++|+.||...|+.++|+|..+.++|++   |.|++.||||+..+ |+.+. +..|...|.|...+|--
T Consensus       133 ~~~r~-----~Sv~Tf~gh~~~Iy~a~~sp~~~nlfas~---Sgd~~l~lwdvr~~-gk~~~-i~ah~~Eil~cdw~ky~  202 (311)
T KOG0277|consen  133 DPNRP-----NSVQTFNGHNSCIYQAAFSPHIPNLFASA---SGDGTLRLWDVRSP-GKFMS-IEAHNSEILCCDWSKYN  202 (311)
T ss_pred             cCCCC-----cceEeecCCccEEEEEecCCCCCCeEEEc---cCCceEEEEEecCC-CceeE-EEeccceeEeecccccC
Confidence            99865     46889999999999999999999999997   68999999998644 65544 89999999999888866


Q ss_pred             hhhh
Q 000080         2379 NFAL 2382 (2389)
Q Consensus      2379 ~~~~ 2382 (2389)
                      +..|
T Consensus       203 ~~vl  206 (311)
T KOG0277|consen  203 HNVL  206 (311)
T ss_pred             CcEE
Confidence            5544


No 72 
>KOG0973 consensus Histone transcription regulator HIRA, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning; Transcription]
Probab=99.43  E-value=8.5e-13  Score=170.80  Aligned_cols=143  Identities=17%  Similarity=0.154  Sum_probs=119.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCC-------Cc-----------eeeEecccCCCCCCCCCCCCCEEEEEECC
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK-------DK-----------ATATYGVLPAANVPPPYALASISALQFDH 2281 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~t-------Gk-----------~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP 2281 (2389)
                      ..|.+|-|+|||++||+||+|+.|.+|+...       |.           ++.+|+          ||.+.|..|+++|
T Consensus        70 ~sv~CVR~S~dG~~lAsGSDD~~v~iW~~~~~~~~~~fgs~g~~~~vE~wk~~~~l~----------~H~~DV~Dv~Wsp  139 (942)
T KOG0973|consen   70 GSVNCVRFSPDGSYLASGSDDRLVMIWERAEIGSGTVFGSTGGAKNVESWKVVSILR----------GHDSDVLDVNWSP  139 (942)
T ss_pred             CceeEEEECCCCCeEeeccCcceEEEeeecccCCcccccccccccccceeeEEEEEe----------cCCCccceeccCC
Confidence            3678999999999999999999999999762       11           233443          6789999999999


Q ss_pred             CCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE
Q 000080         2282 YGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus      2282 DG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s 2361 (2389)
                      ||.+|||+|.|++|-+||..+.     +.+..+.+|++.|-.|+|.| -|+++||-   |+|+||++|++.  .-++.++
T Consensus       140 ~~~~lvS~s~DnsViiwn~~tF-----~~~~vl~~H~s~VKGvs~DP-~Gky~ASq---sdDrtikvwrt~--dw~i~k~  208 (942)
T KOG0973|consen  140 DDSLLVSVSLDNSVIIWNAKTF-----ELLKVLRGHQSLVKGVSWDP-IGKYFASQ---SDDRTLKVWRTS--DWGIEKS  208 (942)
T ss_pred             CccEEEEecccceEEEEccccc-----eeeeeeecccccccceEECC-ccCeeeee---cCCceEEEEEcc--cceeeEe
Confidence            9999999999999999999987     46788999999999999999 99999996   699999999973  3445677


Q ss_pred             EEeecC------cEEEEeecccchhhhc
Q 000080         2362 ITCHEG------LYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2362 L~GH~~------~V~svA~~~~~~~~~s 2383 (2389)
                      +.++.+      -+.-++=||||.++.|
T Consensus       209 It~pf~~~~~~T~f~RlSWSPDG~~las  236 (942)
T KOG0973|consen  209 ITKPFEESPLTTFFLRLSWSPDGHHLAS  236 (942)
T ss_pred             eccchhhCCCcceeeecccCCCcCeecc
Confidence            766554      3457888899888765


No 73 
>KOG0282 consensus mRNA splicing factor [Function unknown]
Probab=99.42  E-value=7.8e-14  Score=168.65  Aligned_cols=141  Identities=16%  Similarity=0.235  Sum_probs=119.8

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      .|.++.|.| .+.+|+|||-|+.|+|||+.. ++|++||.          ||...|++++||++|..|.|+|-|++||||
T Consensus       216 gvsai~~fp~~~hLlLS~gmD~~vklW~vy~~~~~lrtf~----------gH~k~Vrd~~~s~~g~~fLS~sfD~~lKlw  285 (503)
T KOG0282|consen  216 GVSAIQWFPKKGHLLLSGGMDGLVKLWNVYDDRRCLRTFK----------GHRKPVRDASFNNCGTSFLSASFDRFLKLW  285 (503)
T ss_pred             ccchhhhccceeeEEEecCCCceEEEEEEecCcceehhhh----------cchhhhhhhhccccCCeeeeeecceeeeee
Confidence            458889999 899999999999999999876 78999995          577899999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCC-CeeEEEEecCCC-CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSS-HAMDVSYITSSG-SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~-~V~sVAFSP~DG-slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      |++||.     +...+  |.+ .+++|-|.| |+ +.+.+||   .|+.|+.||+  .+++.+|...-|-+.|..+.|-+
T Consensus       286 DtETG~-----~~~~f--~~~~~~~cvkf~p-d~~n~fl~G~---sd~ki~~wDi--Rs~kvvqeYd~hLg~i~~i~F~~  352 (503)
T KOG0282|consen  286 DTETGQ-----VLSRF--HLDKVPTCVKFHP-DNQNIFLVGG---SDKKIRQWDI--RSGKVVQEYDRHLGAILDITFVD  352 (503)
T ss_pred             ccccce-----EEEEE--ecCCCceeeecCC-CCCcEEEEec---CCCcEEEEec--cchHHHHHHHhhhhheeeeEEcc
Confidence            999983     33333  443 456899999 55 6666653   7899999998  46788999999999999999999


Q ss_pred             cchhhhcc
Q 000080         2377 LLNFALSK 2384 (2389)
Q Consensus      2377 ~~~~~~s~ 2384 (2389)
                      .|++-+|.
T Consensus       353 ~g~rFiss  360 (503)
T KOG0282|consen  353 EGRRFISS  360 (503)
T ss_pred             CCceEeee
Confidence            99876653


No 74 
>KOG0647 consensus mRNA export protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.42  E-value=1.5e-12  Score=151.20  Aligned_cols=186  Identities=12%  Similarity=0.160  Sum_probs=144.0

Q ss_pred             CCccccCccccccccccccceeeccccccccccccccCCCCc------CceeEEEEEEcCCCCeEEEEeCCCcEEEeecC
Q 000080         2176 PGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATV------ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG 2249 (2389)
Q Consensus      2176 ~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv------~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~ 2249 (2389)
                      |+.++....+|+- -.+.|+|.| +||.+.|.|++.+.-..+      .+-+|-+++|+-||..+++|+.|+.+++||+.
T Consensus        25 pP~DsIS~l~FSP-~~~~~~~A~-SWD~tVR~wevq~~g~~~~ka~~~~~~PvL~v~WsddgskVf~g~~Dk~~k~wDL~  102 (347)
T KOG0647|consen   25 PPEDSISALAFSP-QADNLLAAG-SWDGTVRIWEVQNSGQLVPKAQQSHDGPVLDVCWSDDGSKVFSGGCDKQAKLWDLA  102 (347)
T ss_pred             CcccchheeEecc-ccCceEEec-ccCCceEEEEEecCCcccchhhhccCCCeEEEEEccCCceEEeeccCCceEEEEcc
Confidence            3444446677764 556677778 999999999997531221      12478999999999999999999999999999


Q ss_pred             CCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEeeCCCCC---------c-------------
Q 000080         2250 KDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTWQLEVGG---------R------------- 2305 (2389)
Q Consensus      2250 tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLWDl~tgg---------r------------- 2305 (2389)
                      +|+..+.-           .|.+.|+.+.|-+...  .|++||+|.|||.||.+...         |             
T Consensus       103 S~Q~~~v~-----------~Hd~pvkt~~wv~~~~~~cl~TGSWDKTlKfWD~R~~~pv~t~~LPeRvYa~Dv~~pm~vV  171 (347)
T KOG0647|consen  103 SGQVSQVA-----------AHDAPVKTCHWVPGMNYQCLVTGSWDKTLKFWDTRSSNPVATLQLPERVYAADVLYPMAVV  171 (347)
T ss_pred             CCCeeeee-----------ecccceeEEEEecCCCcceeEecccccceeecccCCCCeeeeeeccceeeehhccCceeEE
Confidence            99654432           2678899999987776  99999999999999997641         1             


Q ss_pred             ----------------------------------------------------------cCcccceeeeecC---------
Q 000080         2306 ----------------------------------------------------------SNVRPMESCLCFS--------- 2318 (2389)
Q Consensus      2306 ----------------------------------------------------------s~~k~l~tl~gHs--------- 2318 (2389)
                                                                                .+++.-+++.||.         
T Consensus       172 ata~r~i~vynL~n~~te~k~~~SpLk~Q~R~va~f~d~~~~alGsiEGrv~iq~id~~~~~~nFtFkCHR~~~~~~~~V  251 (347)
T KOG0647|consen  172 ATAERHIAVYNLENPPTEFKRIESPLKWQTRCVACFQDKDGFALGSIEGRVAIQYIDDPNPKDNFTFKCHRSTNSVNDDV  251 (347)
T ss_pred             EecCCcEEEEEcCCCcchhhhhcCcccceeeEEEEEecCCceEeeeecceEEEEecCCCCccCceeEEEeccCCCCCCce
Confidence                                                                      0224456778887         


Q ss_pred             CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2319 SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2319 ~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +.|++|+|+| .-..|||+|   .||+...||-  .....+.+-+-|...|+|-++..+|..
T Consensus       252 YaVNsi~FhP-~hgtlvTaG---sDGtf~FWDk--dar~kLk~s~~~~qpItcc~fn~~G~i  307 (347)
T KOG0647|consen  252 YAVNSIAFHP-VHGTLVTAG---SDGTFSFWDK--DARTKLKTSETHPQPITCCSFNRNGSI  307 (347)
T ss_pred             EEecceEeec-ccceEEEec---CCceEEEecc--hhhhhhhccCcCCCccceeEecCCCCE
Confidence            3577999999 567788997   7999999995  223346777789999999999999974


No 75 
>KOG0274 consensus Cdc4 and related F-box and WD-40 proteins [General function prediction only]
Probab=99.42  E-value=6.2e-13  Score=168.83  Aligned_cols=156  Identities=16%  Similarity=0.243  Sum_probs=127.3

Q ss_pred             cccceeeccccccccccccccCCCC--cC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2192 AGIGASALGWETQDDFEDYVDPPAT--VE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~d~~at--v~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      ++.+.+| +.|.++++|+.....-+  +.  .-.|+.+..  .+..+++||.|.|||+||+.+|+++.+++         
T Consensus       261 ~~~lvsg-S~D~t~rvWd~~sg~C~~~l~gh~stv~~~~~--~~~~~~sgs~D~tVkVW~v~n~~~l~l~~---------  328 (537)
T KOG0274|consen  261 GDKLVSG-STDKTERVWDCSTGECTHSLQGHTSSVRCLTI--DPFLLVSGSRDNTVKVWDVTNGACLNLLR---------  328 (537)
T ss_pred             CCEEEEE-ecCCcEEeEecCCCcEEEEecCCCceEEEEEc--cCceEeeccCCceEEEEeccCcceEEEec---------
Confidence            5667888 88999999986432111  11  113344444  44568999999999999999999999985         


Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                       ||.+.|++|+++  +..+.+|+.|++|++||++++     +++.+++||+..|+++.+.+ . ..+.+|   |.|++||
T Consensus       329 -~h~~~V~~v~~~--~~~lvsgs~d~~v~VW~~~~~-----~cl~sl~gH~~~V~sl~~~~-~-~~~~Sg---s~D~~Ik  395 (537)
T KOG0274|consen  329 -GHTGPVNCVQLD--EPLLVSGSYDGTVKVWDPRTG-----KCLKSLSGHTGRVYSLIVDS-E-NRLLSG---SLDTTIK  395 (537)
T ss_pred             -cccccEEEEEec--CCEEEEEecCceEEEEEhhhc-----eeeeeecCCcceEEEEEecC-c-ceEEee---eeccceE
Confidence             477999999999  889999999999999999986     68999999999999998876 3 788886   6899999


Q ss_pred             EeeCCCCCC-CceEEEEeecCcEEEEee
Q 000080         2348 VWDTLAPPT-SSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2348 LWD~l~~tg-~~v~sL~GH~~~V~svA~ 2374 (2389)
                      +||+  .+. +|+++|.+|+.-|.++..
T Consensus       396 vWdl--~~~~~c~~tl~~h~~~v~~l~~  421 (537)
T KOG0274|consen  396 VWDL--RTKRKCIHTLQGHTSLVSSLLL  421 (537)
T ss_pred             eecC--CchhhhhhhhcCCccccccccc
Confidence            9998  455 799999999999876654


No 76 
>KOG0308 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.42  E-value=3.4e-13  Score=166.89  Aligned_cols=169  Identities=18%  Similarity=0.224  Sum_probs=134.2

Q ss_pred             cccccccccccccC-CCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--ceeeEecccCCCCCCCCCCCCCE
Q 000080         2200 GWETQDDFEDYVDP-PATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--KATATYGVLPAANVPPPYALASI 2274 (2389)
Q Consensus      2200 ~~d~~~~~~~~~d~-~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~~p~~GH~~~V 2274 (2389)
                      .|+..++...+.++ .++++  +-.|..++..-+|+.|+|+|.|.||++|+...+  .|+.|++          -|.++|
T Consensus        51 ~W~~~~d~~~~s~~~~asme~HsDWVNDiiL~~~~~tlIS~SsDtTVK~W~~~~~~~~c~stir----------~H~DYV  120 (735)
T KOG0308|consen   51 LWSVTQDSNEPSTPYIASMEHHSDWVNDIILCGNGKTLISASSDTTVKVWNAHKDNTFCMSTIR----------THKDYV  120 (735)
T ss_pred             EeccccccCCcccchhhhhhhhHhHHhhHHhhcCCCceEEecCCceEEEeecccCcchhHhhhh----------cccchh
Confidence            45555555544333 22222  123466788888999999999999999999877  6888885          278999


Q ss_pred             EEEEE-CCCCCEEEEEeCCCcEEEeeCCCCCc-----cCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2275 SALQF-DHYGHRFASAALDGTVCTWQLEVGGR-----SNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2275 ~sVaF-SPDG~~LASgS~DgTVkLWDl~tggr-----s~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                      .++++ -++...+|||+.|+.|.|||+++|..     .+..+..++. ||-..|+++|-++ .|..|++||   -.+-+|
T Consensus       121 kcla~~ak~~~lvaSgGLD~~IflWDin~~~~~l~~s~n~~t~~sl~sG~k~siYSLA~N~-t~t~ivsGg---tek~lr  196 (735)
T KOG0308|consen  121 KCLAYIAKNNELVASGGLDRKIFLWDINTGTATLVASFNNVTVNSLGSGPKDSIYSLAMNQ-TGTIIVSGG---TEKDLR  196 (735)
T ss_pred             eeeeecccCceeEEecCCCccEEEEEccCcchhhhhhccccccccCCCCCccceeeeecCC-cceEEEecC---cccceE
Confidence            99999 89999999999999999999998721     1222333444 8899999999999 999999874   678999


Q ss_pred             EeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      +||.  .+.+.+..|+||+..|+++-.+.+|+++||.
T Consensus       197 ~wDp--rt~~kimkLrGHTdNVr~ll~~dDGt~~ls~  231 (735)
T KOG0308|consen  197 LWDP--RTCKKIMKLRGHTDNVRVLLVNDDGTRLLSA  231 (735)
T ss_pred             Eecc--ccccceeeeeccccceEEEEEcCCCCeEeec
Confidence            9997  3666789999999999999999999998874


No 77 
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.41  E-value=2.8e-13  Score=156.88  Aligned_cols=148  Identities=18%  Similarity=0.267  Sum_probs=120.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|..+.|||...+|+|||.|+||||+|+.+....+.++++.+        ...|+++.|.|.|.+|+.|.+-.++||+|+
T Consensus       174 evn~l~FHPre~ILiS~srD~tvKlFDfsK~saKrA~K~~qd--------~~~vrsiSfHPsGefllvgTdHp~~rlYdv  245 (430)
T KOG0640|consen  174 EVNDLDFHPRETILISGSRDNTVKLFDFSKTSAKRAFKVFQD--------TEPVRSISFHPSGEFLLVGTDHPTLRLYDV  245 (430)
T ss_pred             cccceeecchhheEEeccCCCeEEEEecccHHHHHHHHHhhc--------cceeeeEeecCCCceEEEecCCCceeEEec
Confidence            457789999999999999999999999986655555544332        256999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecC-cEEEEeecccc
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEG-LYDLFLPLKLL 2378 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~-~V~svA~~~~~ 2378 (2389)
                      +|..  +-.+--.-.+|++.|.+|.|++ +|++.+||   |.||.|||||-.  .++|+.++ ..|.+ .|.+.-+.+.|
T Consensus       246 ~T~Q--cfvsanPd~qht~ai~~V~Ys~-t~~lYvTa---SkDG~IklwDGV--S~rCv~t~~~AH~gsevcSa~Ftkn~  317 (430)
T KOG0640|consen  246 NTYQ--CFVSANPDDQHTGAITQVRYSS-TGSLYVTA---SKDGAIKLWDGV--SNRCVRTIGNAHGGSEVCSAVFTKNG  317 (430)
T ss_pred             ccee--EeeecCcccccccceeEEEecC-CccEEEEe---ccCCcEEeeccc--cHHHHHHHHhhcCCceeeeEEEccCC
Confidence            9962  1111123467999999999999 99999997   799999999964  57898888 44654 46678889999


Q ss_pred             hhhhcc
Q 000080         2379 NFALSK 2384 (2389)
Q Consensus      2379 ~~~~s~ 2384 (2389)
                      +++||.
T Consensus       318 kyiLsS  323 (430)
T KOG0640|consen  318 KYILSS  323 (430)
T ss_pred             eEEeec
Confidence            999984


No 78 
>KOG0313 consensus Microtubule binding protein YTM1 (contains WD40 repeats) [Cytoskeleton]
Probab=99.40  E-value=1.5e-12  Score=154.47  Aligned_cols=176  Identities=18%  Similarity=0.204  Sum_probs=129.8

Q ss_pred             cceeeccccccccccccccCCCCcC--------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec-------
Q 000080         2194 IGASALGWETQDDFEDYVDPPATVE--------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG------- 2258 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~d~~atv~--------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~------- 2258 (2389)
                      ..+++ +-|-+.++|.+......+.        --+|-+|+..++|..++|||.|.+|+||+..+... .++.       
T Consensus       161 ~fvsa-s~Dqtl~Lw~~~~~~~~~~~~~~~~GHk~~V~sVsv~~sgtr~~SgS~D~~lkiWs~~~~~~-~~~E~~s~~rr  238 (423)
T KOG0313|consen  161 LFVSA-SMDQTLRLWKWNVGENKVKALKVCRGHKRSVDSVSVDSSGTRFCSGSWDTMLKIWSVETDEE-DELESSSNRRR  238 (423)
T ss_pred             eEEEe-cCCceEEEEEecCchhhhhHHhHhcccccceeEEEecCCCCeEEeecccceeeecccCCCcc-ccccccchhhh
Confidence            45666 7777888887753322211        12568889999999999999999999999432110 0110       


Q ss_pred             ------ccCCCC---CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC
Q 000080         2259 ------VLPAAN---VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS 2329 (2389)
Q Consensus      2259 ------vl~gh~---~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~ 2329 (2389)
                            ...+.+   +...||...|.+|.|++ ...+-|+|.|.|||.||+++|+     ...++.+ .+..++|+++| 
T Consensus       239 k~~~~~~~~~~r~P~vtl~GHt~~Vs~V~w~d-~~v~yS~SwDHTIk~WDletg~-----~~~~~~~-~ksl~~i~~~~-  310 (423)
T KOG0313|consen  239 KKQKREKEGGTRTPLVTLEGHTEPVSSVVWSD-ATVIYSVSWDHTIKVWDLETGG-----LKSTLTT-NKSLNCISYSP-  310 (423)
T ss_pred             hhhhhhhcccccCceEEecccccceeeEEEcC-CCceEeecccceEEEEEeeccc-----ceeeeec-CcceeEeeccc-
Confidence                  000011   12458899999999999 6689999999999999999985     2333332 46788999999 


Q ss_pred             CCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecccchhhh
Q 000080         2330 SGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2330 DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      ...+||+|   |.|+.|||||.....+.. .++|.||.++|.++.-+|.--|.|
T Consensus       311 ~~~Ll~~g---ssdr~irl~DPR~~~gs~v~~s~~gH~nwVssvkwsp~~~~~~  361 (423)
T KOG0313|consen  311 LSKLLASG---SSDRHIRLWDPRTGDGSVVSQSLIGHKNWVSSVKWSPTNEFQL  361 (423)
T ss_pred             ccceeeec---CCCCceeecCCCCCCCceeEEeeecchhhhhheecCCCCceEE
Confidence            88999986   689999999997665555 489999999999999888766544


No 79 
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.40  E-value=1.4e-12  Score=157.48  Aligned_cols=145  Identities=16%  Similarity=0.266  Sum_probs=118.2

Q ss_pred             eEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080         2221 STRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus      2221 ~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
                      .|..|+|||- ..+++|.++|+.+.|||+++++  +..+-          .+|.+.|.+|+|+|-+ ..|||||.|+||+
T Consensus       229 ~VeDV~~h~~h~~lF~sv~dd~~L~iwD~R~~~~~~~~~~----------~ah~~~vn~~~fnp~~~~ilAT~S~D~tV~  298 (422)
T KOG0264|consen  229 VVEDVAWHPLHEDLFGSVGDDGKLMIWDTRSNTSKPSHSV----------KAHSAEVNCVAFNPFNEFILATGSADKTVA  298 (422)
T ss_pred             ceehhhccccchhhheeecCCCeEEEEEcCCCCCCCcccc----------cccCCceeEEEeCCCCCceEEeccCCCcEE
Confidence            4577899996 4489999999999999999642  22221          3578999999999975 7999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC------------CceEEEEe
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT------------SSRASITC 2364 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg------------~~v~sL~G 2364 (2389)
                      |||++.-.    +++.++.+|...|..|.|||+..++|||+|   .|+.+.+||+..-..            +.+-.--|
T Consensus       299 LwDlRnL~----~~lh~~e~H~dev~~V~WSPh~etvLASSg---~D~rl~vWDls~ig~eq~~eda~dgppEllF~HgG  371 (422)
T KOG0264|consen  299 LWDLRNLN----KPLHTFEGHEDEVFQVEWSPHNETVLASSG---TDRRLNVWDLSRIGEEQSPEDAEDGPPELLFIHGG  371 (422)
T ss_pred             Eeechhcc----cCceeccCCCcceEEEEeCCCCCceeEecc---cCCcEEEEeccccccccChhhhccCCcceeEEecC
Confidence            99999752    688999999999999999999889999974   899999999832111            12345578


Q ss_pred             ecCcEEEEeecccchhhh
Q 000080         2365 HEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2365 H~~~V~svA~~~~~~~~~ 2382 (2389)
                      |+..|..++-.|.-.|.+
T Consensus       372 H~~kV~DfsWnp~ePW~I  389 (422)
T KOG0264|consen  372 HTAKVSDFSWNPNEPWTI  389 (422)
T ss_pred             cccccccccCCCCCCeEE
Confidence            999999999888877754


No 80 
>KOG0281 consensus Beta-TrCP (transducin repeats containing)/Slimb proteins [Function unknown]
Probab=99.39  E-value=3.3e-13  Score=157.76  Aligned_cols=131  Identities=15%  Similarity=0.188  Sum_probs=109.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|..|.|+  .++|+|+|.|.|||+|++.++.+++|+.          ||...|.++++  .|++++|||.|+||||||+
T Consensus       322 aVNvVdfd--~kyIVsASgDRTikvW~~st~efvRtl~----------gHkRGIAClQY--r~rlvVSGSSDntIRlwdi  387 (499)
T KOG0281|consen  322 AVNVVDFD--DKYIVSASGDRTIKVWSTSTCEFVRTLN----------GHKRGIACLQY--RDRLVVSGSSDNTIRLWDI  387 (499)
T ss_pred             heeeeccc--cceEEEecCCceEEEEeccceeeehhhh----------cccccceehhc--cCeEEEecCCCceEEEEec
Confidence            44566775  4599999999999999999999999983          56677777766  6899999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC-------CceEEEEeecCcEEEEe
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT-------SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg-------~~v~sL~GH~~~V~svA 2373 (2389)
                      +.|     .+++-++||+.-|++|.|..   +.|+|||   -||+||+||+..+-.       -|+.++.-|++.|--+-
T Consensus       388 ~~G-----~cLRvLeGHEeLvRciRFd~---krIVSGa---YDGkikvWdl~aaldpra~~~~~Cl~~lv~hsgRVFrLQ  456 (499)
T KOG0281|consen  388 ECG-----ACLRVLEGHEELVRCIRFDN---KRIVSGA---YDGKIKVWDLQAALDPRAPASTLCLRTLVEHSGRVFRLQ  456 (499)
T ss_pred             ccc-----HHHHHHhchHHhhhheeecC---ceeeecc---ccceEEEEecccccCCcccccchHHHhhhhccceeEEEe
Confidence            997     57888999999999999986   8899964   899999999843222       26788888999998776


Q ss_pred             ecc
Q 000080         2374 PLK 2376 (2389)
Q Consensus      2374 ~~~ 2376 (2389)
                      |.+
T Consensus       457 FD~  459 (499)
T KOG0281|consen  457 FDE  459 (499)
T ss_pred             ecc
Confidence            643


No 81 
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.39  E-value=1.3e-12  Score=149.67  Aligned_cols=150  Identities=17%  Similarity=0.205  Sum_probs=129.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
                      .|++|+|+-+|..||+||.|+++++|++..++.+..+.   .     -||.+.|-+++++|.. ..||+++.|.+|++||
T Consensus        22 ~v~Sv~wn~~g~~lasgs~dktv~v~n~e~~r~~~~~~---~-----~gh~~svdql~w~~~~~d~~atas~dk~ir~wd   93 (313)
T KOG1407|consen   22 KVHSVAWNCDGTKLASGSFDKTVSVWNLERDRFRKELV---Y-----RGHTDSVDQLCWDPKHPDLFATASGDKTIRIWD   93 (313)
T ss_pred             cceEEEEcccCceeeecccCCceEEEEecchhhhhhhc---c-----cCCCcchhhheeCCCCCcceEEecCCceEEEEE
Confidence            45889999999999999999999999998886655442   1     2677999999999764 8999999999999999


Q ss_pred             CCCCCc--------------------------------------------------------------------------
Q 000080         2300 LEVGGR-------------------------------------------------------------------------- 2305 (2389)
Q Consensus      2300 l~tggr-------------------------------------------------------------------------- 2305 (2389)
                      ++++..                                                                          
T Consensus        94 ~r~~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne~~w~~~nd~Fflt~GlG~v~I  173 (313)
T KOG1407|consen   94 IRSGKCTARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNEISWNNSNDLFFLTNGLGCVEI  173 (313)
T ss_pred             eccCcEEEEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeeeeeecCCCCEEEEecCCceEEE
Confidence            988632                                                                          


Q ss_pred             ---cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2306 ---SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2306 ---s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                         -.++|++++.+|+..+.+|.|+| +|+++|+|   |.|..|-|||+  ..--|++++.-|+-+|+.|+|+-+|+.+-
T Consensus       174 LsypsLkpv~si~AH~snCicI~f~p-~GryfA~G---sADAlvSLWD~--~ELiC~R~isRldwpVRTlSFS~dg~~lA  247 (313)
T KOG1407|consen  174 LSYPSLKPVQSIKAHPSNCICIEFDP-DGRYFATG---SADALVSLWDV--DELICERCISRLDWPVRTLSFSHDGRMLA  247 (313)
T ss_pred             EeccccccccccccCCcceEEEEECC-CCceEeec---cccceeeccCh--hHhhhheeeccccCceEEEEeccCcceee
Confidence               13578899999999999999999 99999996   69999999998  33457899999999999999999999876


Q ss_pred             cc
Q 000080         2383 SK 2384 (2389)
Q Consensus      2383 s~ 2384 (2389)
                      |.
T Consensus       248 Sa  249 (313)
T KOG1407|consen  248 SA  249 (313)
T ss_pred             cc
Confidence            64


No 82 
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.39  E-value=8.6e-13  Score=156.77  Aligned_cols=134  Identities=19%  Similarity=0.255  Sum_probs=108.9

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLW 2298 (2389)
                      +|-.++|+| +.+.|||||+|.+|++|++-.+...+.+.. |.  .-..||...|--|++.|-. +.|+|++.|++|.+|
T Consensus        83 ~vLDi~w~PfnD~vIASgSeD~~v~vW~IPe~~l~~~lte-pv--v~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iW  159 (472)
T KOG0303|consen   83 PVLDIDWCPFNDCVIASGSEDTKVMVWQIPENGLTRDLTE-PV--VELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIW  159 (472)
T ss_pred             cccccccCccCCceeecCCCCceEEEEECCCcccccCccc-ce--EEEeecceeEEEEeecccchhhHhhccCCceEEEE
Confidence            457779999 566899999999999999987665544320 00  1134788999999999996 899999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY 2369 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V 2369 (2389)
                      |+.||.     .+.++. |..-|+++.|+. ||++|+|+   +.|+.|||||.  .+++.++.-.+|++.-
T Consensus       160 nv~tge-----ali~l~-hpd~i~S~sfn~-dGs~l~Tt---ckDKkvRv~dp--r~~~~v~e~~~heG~k  218 (472)
T KOG0303|consen  160 NVGTGE-----ALITLD-HPDMVYSMSFNR-DGSLLCTT---CKDKKVRVIDP--RRGTVVSEGVAHEGAK  218 (472)
T ss_pred             eccCCc-----eeeecC-CCCeEEEEEecc-CCceeeee---cccceeEEEcC--CCCcEeeecccccCCC
Confidence            999983     455665 999999999999 99999996   69999999997  4566677778888643


No 83 
>KOG1332 consensus Vesicle coat complex COPII, subunit SEC13 [Intracellular trafficking, secretion, and vesicular transport]
Probab=99.37  E-value=1.7e-12  Score=147.68  Aligned_cols=178  Identities=20%  Similarity=0.294  Sum_probs=121.8

Q ss_pred             eee-eccCCCCCeeEEEEcCCCCCCCcEE-EecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecC--CCCeE
Q 000080           86 QVF-ALSDNSLPVTSISWSPETPSIGQLA-AASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTG--SGDGI  160 (2389)
Q Consensus        86 Qvi-egh~d~~dVk~VaWSPd~~~~GeIa-ASyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSp--dG~rL  160 (2389)
                      |.| .+|.|  -|-.+.--=.   +..|| ||+|++||||.-.+     +-+=...++|+ |++.||.++|--  -|..|
T Consensus         4 q~idt~H~D--~IHda~lDyy---gkrlATcsSD~tVkIf~v~~-----n~~s~ll~~L~Gh~GPVwqv~wahPk~G~iL   73 (299)
T KOG1332|consen    4 QTIDTQHED--MIHDAQLDYY---GKRLATCSSDGTVKIFEVRN-----NGQSKLLAELTGHSGPVWKVAWAHPKFGTIL   73 (299)
T ss_pred             eehhhhhhh--hhhHhhhhhh---cceeeeecCCccEEEEEEcC-----CCCceeeeEecCCCCCeeEEeecccccCcEe
Confidence            444 44555  3333333332   45677 57899999998652     11224466776 899999999998  99999


Q ss_pred             EEEecc--eEEeeccCCcEEEEEEeeccccceEEEEeecCC--Cc-eEeeecccccccCCCCCCCceeEEEeeCCCccce
Q 000080          161 VAGGME--TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIE--GP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYI  235 (2389)
Q Consensus       161 aSggdD--V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpd--G~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~  235 (2389)
                      |||+.|  |-||+..++.|...... ..|..++-+|+|-|.  |. +|.++.|.+          -+|+.+..++.-.-.
T Consensus        74 AScsYDgkVIiWke~~g~w~k~~e~-~~h~~SVNsV~wapheygl~LacasSDG~----------vsvl~~~~~g~w~t~  142 (299)
T KOG1332|consen   74 ASCSYDGKVIIWKEENGRWTKAYEH-AAHSASVNSVAWAPHEYGLLLACASSDGK----------VSVLTYDSSGGWTTS  142 (299)
T ss_pred             eEeecCceEEEEecCCCchhhhhhh-hhhcccceeecccccccceEEEEeeCCCc----------EEEEEEcCCCCccch
Confidence            999998  88999999999876542 345556668899996  55 888888765          234433333333334


Q ss_pred             eecccCCCCeeEEEeccCCCC---CCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080          236 KLELCHPQPVSMVQWRPSTRR---HSPGDTKRSQRHVLLTCCLDGTVRLWCEMD  286 (2389)
Q Consensus       236 ~ve~aH~qdVn~V~W~Ps~~~---~~~~Dgk~~~~nILAScSdDgTVRLW~e~d  286 (2389)
                      ....||+.-||+|+|.|.+.-   ...+-..  .-..|||++-|++||||+++.
T Consensus       143 ki~~aH~~GvnsVswapa~~~g~~~~~~~~~--~~krlvSgGcDn~VkiW~~~~  194 (299)
T KOG1332|consen  143 KIVFAHEIGVNSVSWAPASAPGSLVDQGPAA--KVKRLVSGGCDNLVKIWKFDS  194 (299)
T ss_pred             hhhhccccccceeeecCcCCCccccccCccc--ccceeeccCCccceeeeecCC
Confidence            467999999999999995321   1111111  123499999999999999875


No 84 
>KOG0640 consensus mRNA cleavage stimulating factor complex; subunit 1 [RNA processing and modification]
Probab=99.37  E-value=2.8e-12  Score=148.82  Aligned_cols=154  Identities=18%  Similarity=0.323  Sum_probs=124.4

Q ss_pred             cccceeeccccccccccccccCCCCc------CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2192 AGIGASALGWETQDDFEDYVDPPATV------ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~d~~atv------~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      ..|+||| +.|.+.++-+|.++.+..      +--.||+|+|||.|.+|+.|.+--++||+|+.+-+|...-.       
T Consensus       184 e~ILiS~-srD~tvKlFDfsK~saKrA~K~~qd~~~vrsiSfHPsGefllvgTdHp~~rlYdv~T~Qcfvsan-------  255 (430)
T KOG0640|consen  184 ETILISG-SRDNTVKLFDFSKTSAKRAFKVFQDTEPVRSISFHPSGEFLLVGTDHPTLRLYDVNTYQCFVSAN-------  255 (430)
T ss_pred             hheEEec-cCCCeEEEEecccHHHHHHHHHhhccceeeeEeecCCCceEEEecCCCceeEEeccceeEeeecC-------
Confidence            3478899 889999999997554331      11256999999999999999999999999999988865432       


Q ss_pred             CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee-eecC-CCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC-LCFS-SHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl-~gHs-~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                      |.-+|++.|++|.+|+.|+..++||-||.|||||=-++     +++.++ ..|. ..|.+..|.. +|++|.|+|   .|
T Consensus       256 Pd~qht~ai~~V~Ys~t~~lYvTaSkDG~IklwDGVS~-----rCv~t~~~AH~gsevcSa~Ftk-n~kyiLsSG---~D  326 (430)
T KOG0640|consen  256 PDDQHTGAITQVRYSSTGSLYVTASKDGAIKLWDGVSN-----RCVRTIGNAHGGSEVCSAVFTK-NGKYILSSG---KD  326 (430)
T ss_pred             cccccccceeEEEecCCccEEEEeccCCcEEeeccccH-----HHHHHHHhhcCCceeeeEEEcc-CCeEEeecC---Cc
Confidence            55679999999999999999999999999999997654     345443 2355 4567888998 999999975   89


Q ss_pred             CeEEEeeCCCCCCCceEEEEe
Q 000080         2344 INVVVWDTLAPPTSSRASITC 2364 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~G 2364 (2389)
                      .+|+||.+  .++.+++...|
T Consensus       327 S~vkLWEi--~t~R~l~~YtG  345 (430)
T KOG0640|consen  327 STVKLWEI--STGRMLKEYTG  345 (430)
T ss_pred             ceeeeeee--cCCceEEEEec
Confidence            99999998  67788776655


No 85 
>KOG0316 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=99.37  E-value=2.5e-12  Score=145.59  Aligned_cols=163  Identities=14%  Similarity=0.120  Sum_probs=134.3

Q ss_pred             cccccccccccc--cCCCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2200 GWETQDDFEDYV--DPPAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2200 ~~d~~~~~~~~~--d~~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      |-|.+.|+|.-.  ..+.|  -++-.|..++.+.|..-++||+.|..|.+||+.+|+.++.|+          ||.+.|.
T Consensus        36 GsdrtvrLWNp~rg~liktYsghG~EVlD~~~s~Dnskf~s~GgDk~v~vwDV~TGkv~Rr~r----------gH~aqVN  105 (307)
T KOG0316|consen   36 GSDRTVRLWNPLRGALIKTYSGHGHEVLDAALSSDNSKFASCGGDKAVQVWDVNTGKVDRRFR----------GHLAQVN  105 (307)
T ss_pred             CCCceEEeecccccceeeeecCCCceeeeccccccccccccCCCCceEEEEEcccCeeeeecc----------cccceee
Confidence            678899999642  11111  122477999999999999999999999999999999999986          5789999


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      +|+|+.+...++|||-|.++|+||.++.   ..+|++.+......|.+|...-   ..|++|   |-|||+|.+|+.  .
T Consensus       106 tV~fNeesSVv~SgsfD~s~r~wDCRS~---s~ePiQildea~D~V~Si~v~~---heIvaG---S~DGtvRtydiR--~  174 (307)
T KOG0316|consen  106 TVRFNEESSVVASGSFDSSVRLWDCRSR---SFEPIQILDEAKDGVSSIDVAE---HEIVAG---SVDGTVRTYDIR--K  174 (307)
T ss_pred             EEEecCcceEEEeccccceeEEEEcccC---CCCccchhhhhcCceeEEEecc---cEEEee---ccCCcEEEEEee--c
Confidence            9999999999999999999999999974   3478888888889999998875   667654   799999999984  3


Q ss_pred             CCceEEEEeecCcEEEEeecccchhhhccc
Q 000080         2356 TSSRASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2356 g~~v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      |+..--..||+  |+|+.++++||+.|-.|
T Consensus       175 G~l~sDy~g~p--it~vs~s~d~nc~La~~  202 (307)
T KOG0316|consen  175 GTLSSDYFGHP--ITSVSFSKDGNCSLASS  202 (307)
T ss_pred             ceeehhhcCCc--ceeEEecCCCCEEEEee
Confidence            44444456666  99999999999987544


No 86 
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.36  E-value=7.4e-12  Score=150.22  Aligned_cols=163  Identities=14%  Similarity=0.160  Sum_probs=125.8

Q ss_pred             ccccccccccccc--CCCCcC--ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2200 GWETQDDFEDYVD--PPATVE--NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2200 ~~d~~~~~~~~~d--~~atv~--ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      +-|..+++|..-.  .++.+.  .-+|+.+..||+|.||+++|.|+++-+-|+++|+++....   +.     +..-.++
T Consensus       280 Sad~~i~vws~~~~s~~~~~~~h~~~V~~ls~h~tgeYllsAs~d~~w~Fsd~~~g~~lt~vs---~~-----~s~v~~t  351 (506)
T KOG0289|consen  280 SADEIIRVWSVPLSSEPTSSRPHEEPVTGLSLHPTGEYLLSASNDGTWAFSDISSGSQLTVVS---DE-----TSDVEYT  351 (506)
T ss_pred             CCcceEEeeccccccCccccccccccceeeeeccCCcEEEEecCCceEEEEEccCCcEEEEEe---ec-----cccceeE
Confidence            4455566665421  111111  2367999999999999999999999999999999876542   10     1123589


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      +.+|.|||..|++|..||.||+||+..+     .....+.||++.|.+|+|+- +|-+||++   ++|+.|++||+.  .
T Consensus       352 s~~fHpDgLifgtgt~d~~vkiwdlks~-----~~~a~Fpght~~vk~i~FsE-NGY~Lat~---add~~V~lwDLR--K  420 (506)
T KOG0289|consen  352 SAAFHPDGLIFGTGTPDGVVKIWDLKSQ-----TNVAKFPGHTGPVKAISFSE-NGYWLATA---ADDGSVKLWDLR--K  420 (506)
T ss_pred             EeeEcCCceEEeccCCCceEEEEEcCCc-----cccccCCCCCCceeEEEecc-CceEEEEE---ecCCeEEEEEeh--h
Confidence            9999999999999999999999999975     24667889999999999998 99999997   589999999984  2


Q ss_pred             CCceEEEEeec-CcEEEEeecccchhh
Q 000080         2356 TSSRASITCHE-GLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2356 g~~v~sL~GH~-~~V~svA~~~~~~~~ 2381 (2389)
                      -+..++++--+ .+|.++.+...|.+.
T Consensus       421 l~n~kt~~l~~~~~v~s~~fD~SGt~L  447 (506)
T KOG0289|consen  421 LKNFKTIQLDEKKEVNSLSFDQSGTYL  447 (506)
T ss_pred             hcccceeeccccccceeEEEcCCCCeE
Confidence            33466665443 268888888888764


No 87 
>KOG0264 consensus Nucleosome remodeling factor, subunit CAF1/NURF55/MSI1 [Chromatin structure and dynamics]
Probab=99.36  E-value=2.9e-12  Score=154.74  Aligned_cols=148  Identities=16%  Similarity=0.187  Sum_probs=117.8

Q ss_pred             EEEEcCCCC-eEEEEeCCCcEEEeecCCCcee-eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080         2224 AFSSHPLRP-FFLVGSSNTHIYLWEFGKDKAT-ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2224 sVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l-~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
                      +++|++..+ .|+|||+|++|.+||+...... .+... ..   -..||.+.|..|+|+|-- +.|+|+++|+.+.|||+
T Consensus       182 glsWn~~~~g~Lls~~~d~~i~lwdi~~~~~~~~~~~p-~~---~~~~h~~~VeDV~~h~~h~~lF~sv~dd~~L~iwD~  257 (422)
T KOG0264|consen  182 GLSWNRQQEGTLLSGSDDHTICLWDINAESKEDKVVDP-KT---IFSGHEDVVEDVAWHPLHEDLFGSVGDDGKLMIWDT  257 (422)
T ss_pred             ccccccccceeEeeccCCCcEEEEeccccccCCccccc-eE---EeecCCcceehhhccccchhhheeecCCCeEEEEEc
Confidence            358888776 6999999999999999754331 11100 00   124788999999999875 89999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +++ .  .++..+..+|++.|++++|+|-++.+||||   |.|+||+|||+.. =.++++++++|...|.+|-.+|.-.-
T Consensus       258 R~~-~--~~~~~~~~ah~~~vn~~~fnp~~~~ilAT~---S~D~tV~LwDlRn-L~~~lh~~e~H~dev~~V~WSPh~et  330 (422)
T KOG0264|consen  258 RSN-T--SKPSHSVKAHSAEVNCVAFNPFNEFILATG---SADKTVALWDLRN-LNKPLHTFEGHEDEVFQVEWSPHNET  330 (422)
T ss_pred             CCC-C--CCCcccccccCCceeEEEeCCCCCceEEec---cCCCcEEEeechh-cccCceeccCCCcceEEEEeCCCCCc
Confidence            974 1  267778889999999999999999999996   6899999999852 23579999999999999988876554


Q ss_pred             hh
Q 000080         2381 AL 2382 (2389)
Q Consensus      2381 ~~ 2382 (2389)
                      +|
T Consensus       331 vL  332 (422)
T KOG0264|consen  331 VL  332 (422)
T ss_pred             ee
Confidence            43


No 88 
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.35  E-value=1.6e-12  Score=147.93  Aligned_cols=164  Identities=20%  Similarity=0.205  Sum_probs=127.1

Q ss_pred             cceeeccccccccccccc--cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceee-EecccCCCCCCCCC
Q 000080         2194 IGASALGWETQDDFEDYV--DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATA-TYGVLPAANVPPPY 2269 (2389)
Q Consensus      2194 ~~Asg~~~d~~~~~~~~~--d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~-Tl~vl~gh~~p~~G 2269 (2389)
                      .+|++ ..|-+.++|+.+  |..-+.+. --|++++|+.|.++|++|+.+.-+|++|+.+.++.. .+          .|
T Consensus        73 ~aasa-aadftakvw~a~tgdelhsf~hkhivk~~af~~ds~~lltgg~ekllrvfdln~p~App~E~----------~g  141 (334)
T KOG0278|consen   73 RAASA-AADFTAKVWDAVTGDELHSFEHKHIVKAVAFSQDSNYLLTGGQEKLLRVFDLNRPKAPPKEI----------SG  141 (334)
T ss_pred             hhhhh-cccchhhhhhhhhhhhhhhhhhhheeeeEEecccchhhhccchHHHhhhhhccCCCCCchhh----------cC
Confidence            34555 556666666654  33333322 127999999999999999999999999998777533 23          36


Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      |.+.|+.+-|-.-.+.|.|.+.|+||||||.++|.     .+.+++ ...+|.++-+++ ||++|.++    ..++|+.|
T Consensus       142 htg~Ir~v~wc~eD~~iLSSadd~tVRLWD~rTgt-----~v~sL~-~~s~VtSlEvs~-dG~ilTia----~gssV~Fw  210 (334)
T KOG0278|consen  142 HTGGIRTVLWCHEDKCILSSADDKTVRLWDHRTGT-----EVQSLE-FNSPVTSLEVSQ-DGRILTIA----YGSSVKFW  210 (334)
T ss_pred             CCCcceeEEEeccCceEEeeccCCceEEEEeccCc-----EEEEEe-cCCCCcceeecc-CCCEEEEe----cCceeEEe
Confidence            78999999999999999999999999999999983     455553 677899999999 99988775    67889999


Q ss_pred             eCC---------------------------------------CCCCCceEEE-EeecCcEEEEeecccch
Q 000080         2350 DTL---------------------------------------APPTSSRASI-TCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2350 D~l---------------------------------------~~tg~~v~sL-~GH~~~V~svA~~~~~~ 2379 (2389)
                      |..                                       ..++..+.++ .||.++|.||.++|+|.
T Consensus       211 daksf~~lKs~k~P~nV~SASL~P~k~~fVaGged~~~~kfDy~TgeEi~~~nkgh~gpVhcVrFSPdGE  280 (334)
T KOG0278|consen  211 DAKSFGLLKSYKMPCNVESASLHPKKEFFVAGGEDFKVYKFDYNTGEEIGSYNKGHFGPVHCVRFSPDGE  280 (334)
T ss_pred             ccccccceeeccCccccccccccCCCceEEecCcceEEEEEeccCCceeeecccCCCCceEEEEECCCCc
Confidence            950                                       1244455555 88999999999999996


No 89 
>KOG0289 consensus mRNA splicing factor [General function prediction only]
Probab=99.35  E-value=4.8e-12  Score=151.77  Aligned_cols=142  Identities=19%  Similarity=0.303  Sum_probs=112.5

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      |.+.+.+|||||-++++|+.|+.||+||+..+..+..|          |||++.|.+|+|+-+|-+||++++|+.|+|||
T Consensus       348 v~~ts~~fHpDgLifgtgt~d~~vkiwdlks~~~~a~F----------pght~~vk~i~FsENGY~Lat~add~~V~lwD  417 (506)
T KOG0289|consen  348 VEYTSAAFHPDGLIFGTGTPDGVVKIWDLKSQTNVAKF----------PGHTGPVKAISFSENGYWLATAADDGSVKLWD  417 (506)
T ss_pred             ceeEEeeEcCCceEEeccCCCceEEEEEcCCccccccC----------CCCCCceeEEEeccCceEEEEEecCCeEEEEE
Confidence            56789999999999999999999999999888866655          46889999999999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2300 LEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      ++.-     +.+.+++--. ..|.++.|.+ +|++|+.+|   .|=+|.+.+-...+-+++..+.-|.+..++|.+-+.-
T Consensus       418 LRKl-----~n~kt~~l~~~~~v~s~~fD~-SGt~L~~~g---~~l~Vy~~~k~~k~W~~~~~~~~~sg~st~v~Fg~~a  488 (506)
T KOG0289|consen  418 LRKL-----KNFKTIQLDEKKEVNSLSFDQ-SGTYLGIAG---SDLQVYICKKKTKSWTEIKELADHSGLSTGVRFGEHA  488 (506)
T ss_pred             ehhh-----cccceeeccccccceeEEEcC-CCCeEEeec---ceeEEEEEecccccceeeehhhhcccccceeeecccc
Confidence            9864     3344443222 3699999999 999999874   5555555553223445678888899888888876654


Q ss_pred             hh
Q 000080         2379 NF 2380 (2389)
Q Consensus      2379 ~~ 2380 (2389)
                      .+
T Consensus       489 q~  490 (506)
T KOG0289|consen  489 QY  490 (506)
T ss_pred             eE
Confidence            43


No 90 
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.35  E-value=9.6e-11  Score=136.79  Aligned_cols=248  Identities=17%  Similarity=0.311  Sum_probs=169.0

Q ss_pred             CCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE--ecCCeEEEEeeC
Q 000080           49 DFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA--ASENCIFVFAHD  126 (2389)
Q Consensus        49 D~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA--SyDntIRVw~~d  126 (2389)
                      |+-|-...++++.-.|=|..+.++..++++.      ..-..|+  ..|+.|.|-|  |.-|+++|  |||.||+||+++
T Consensus        22 D~~GRRmAtCSsDq~vkI~d~~~~s~~W~~T------s~Wrah~--~Si~rV~WAh--PEfGqvvA~cS~Drtv~iWEE~   91 (361)
T KOG2445|consen   22 DFYGRRMATCSSDQTVKIWDSTSDSGTWSCT------SSWRAHD--GSIWRVVWAH--PEFGQVVATCSYDRTVSIWEEQ   91 (361)
T ss_pred             cccCceeeeccCCCcEEEEeccCCCCceEEe------eeEEecC--CcEEEEEecC--ccccceEEEEecCCceeeeeec
Confidence            5558434455555556666666788888877      5555554  3799999977  66899986  689999999985


Q ss_pred             CCCC-CCCccceeeEEecc-cceEEEEeecCC--CCeEEEEecc--eEEeeccC----CcEEEEEEee------ccccce
Q 000080          127 SASS-KGSFCWSQNAILVQ-GTKVEAIEWTGS--GDGIVAGGME--TVLWKKKN----TLWEIAWKFK------ENYPQN  190 (2389)
Q Consensus       127 ~~~~-kgd~~W~~~~tL~h-ssTV~sIAWSpd--G~rLaSggdD--V~IW~~~~----s~Wecvwt~~------~~~~~~  190 (2389)
                      .... ...-+|....+|.. .+.|.+|.|.|.  |-.||+|+-|  ++|++..+    +.|...-.++      +.+.++
T Consensus        92 ~~~~~~~~~~Wv~~ttl~DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nLs~W~Lq~Ei~~~~~pp~~~~~~  171 (361)
T KOG2445|consen   92 EKSEEAHGRRWVRRTTLVDSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNLSQWTLQHEIQNVIDPPGKNKQP  171 (361)
T ss_pred             ccccccccceeEEEEEeecCCcceeEEEecchhcceEEEEeccCcEEEEEecCCccccccchhhhhhhhccCCcccccCc
Confidence            2111 11247999999975 669999999997  6688899887  99999543    4565443332      235567


Q ss_pred             EEEEeecCCC---c-eEeeecccccccCCCCCCCceeEEEeeCCCc-cceee--cccCCCCeeEEEeccCCCCCCCCCCc
Q 000080          191 LVSATWSIEG---P-SATAASMSQLDLLGPKEAGKCVFICCSDGKS-EYIKL--ELCHPQPVSMVQWRPSTRRHSPGDTK  263 (2389)
Q Consensus       191 ivsvaWSpdG---~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~-~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~Dgk  263 (2389)
                      -.|++|+|.-   + ||.++..       .++.-+.|.|++++... .+..+  ...|+.+|..++|.|.-        +
T Consensus       172 ~~CvsWn~sr~~~p~iAvgs~e-------~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dpI~di~wAPn~--------G  236 (361)
T KOG2445|consen  172 CFCVSWNPSRMHEPLIAVGSDE-------DAPHLNKVKIYEYNENGRKWLKVAELPDHTDPIRDISWAPNI--------G  236 (361)
T ss_pred             ceEEeeccccccCceEEEEccc-------CCccccceEEEEecCCcceeeeehhcCCCCCcceeeeecccc--------C
Confidence            8899999853   3 7777664       13444668888876554 34443  36899999999999942        2


Q ss_pred             cccCceEEeeecCCeEEEEEeecCC-------------ccc---ccccccCCCCcc--ceeEEEEEEEeecccccCCC
Q 000080          264 RSQRHVLLTCCLDGTVRLWCEMDSG-------------KTR---KVAKDTNDHKTI--RRSFCVGAIIEINQALNGAL  323 (2389)
Q Consensus       264 ~~~~nILAScSdDgTVRLW~e~d~G-------------k~k---k~~~~~~d~~~~--~~sF~vaA~I~~~~~~~~~l  323 (2389)
                      + .-++||++|.|| ||||.....-             ..+   ++-..-.||+..  ++.|-+-++|=...-..||+
T Consensus       237 r-~y~~lAvA~kDg-v~I~~v~~~~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wNmtGtiLsStGdDG~V  312 (361)
T KOG2445|consen  237 R-SYHLLAVATKDG-VRIFKVKVARSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWNMTGTILSSTGDDGCV  312 (361)
T ss_pred             C-ceeeEEEeecCc-EEEEEEeeccchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEeeeeeEEeecCCCcee
Confidence            2 478999999999 9999977311             000   000011257643  78888888877666455554


No 91 
>KOG0293 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.32  E-value=7.3e-12  Score=149.39  Aligned_cols=144  Identities=10%  Similarity=0.111  Sum_probs=118.8

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce---eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA---TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~---l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      .|+-+.||++|++|||||.|.|.-+|++.....   ..|+.          ||...|.-|.||||.++|.+++.|..++|
T Consensus       226 EVWfl~FS~nGkyLAsaSkD~Taiiw~v~~d~~~kl~~tlv----------gh~~~V~yi~wSPDdryLlaCg~~e~~~l  295 (519)
T KOG0293|consen  226 EVWFLQFSHNGKYLASASKDSTAIIWIVVYDVHFKLKKTLV----------GHSQPVSYIMWSPDDRYLLACGFDEVLSL  295 (519)
T ss_pred             cEEEEEEcCCCeeEeeccCCceEEEEEEecCcceeeeeeee----------cccCceEEEEECCCCCeEEecCchHheee
Confidence            459999999999999999999999999876654   45552          57799999999999999999999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecc
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLK 2376 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~ 2376 (2389)
                      ||+.+|..   ...+. .+|...+.+++|.| ||..+++|   |.|++|..||+   .|+.+.+-+|-. ..|.++|..+
T Consensus       296 wDv~tgd~---~~~y~-~~~~~S~~sc~W~p-Dg~~~V~G---s~dr~i~~wdl---Dgn~~~~W~gvr~~~v~dlait~  364 (519)
T KOG0293|consen  296 WDVDTGDL---RHLYP-SGLGFSVSSCAWCP-DGFRFVTG---SPDRTIIMWDL---DGNILGNWEGVRDPKVHDLAITY  364 (519)
T ss_pred             ccCCcchh---hhhcc-cCcCCCcceeEEcc-CCceeEec---CCCCcEEEecC---CcchhhcccccccceeEEEEEcC
Confidence            99999851   22222 33668899999999 99999985   68999999997   455555555543 5588999999


Q ss_pred             cchhhhccc
Q 000080         2377 LLNFALSKC 2385 (2389)
Q Consensus      2377 ~~~~~~s~~ 2385 (2389)
                      ||.+.|.-|
T Consensus       365 Dgk~vl~v~  373 (519)
T KOG0293|consen  365 DGKYVLLVT  373 (519)
T ss_pred             CCcEEEEEe
Confidence            999988765


No 92 
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.31  E-value=2e-09  Score=135.07  Aligned_cols=603  Identities=16%  Similarity=0.217  Sum_probs=322.8

Q ss_pred             ccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCC
Q 000080           31 EFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIG  110 (2389)
Q Consensus        31 ~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~G  110 (2389)
                      +.+--.+.|.++..+|.|-  |  -+|||++..|++..   |...       .....++||..  +|.|+.|=|+.....
T Consensus         7 ea~~Vgc~R~~~v~sw~~~--~--~vafGa~~~Iav~d---p~k~-------~i~t~l~GH~a--~VnC~~~l~~s~~~a   70 (764)
T KOG1063|consen    7 EAISVGCNRVPKVSSWGPG--G--LVAFGAGPAIAVAD---PEKI-------LIVTTLDGHVA--RVNCVHWLPTSEIVA   70 (764)
T ss_pred             eeeeecccccccccccccc--c--eEEecCCceEEEeC---cccc-------eeEEeccCCcc--ceEEEEEcccccccc
Confidence            3445566799999999653  4  79999999999887   2222       12255688876  999999999711111


Q ss_pred             cEEE-ecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEE-Eecc-eEEeeccCCcEEEEEEeeccc
Q 000080          111 QLAA-ASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVA-GGME-TVLWKKKNTLWEIAWKFKENY  187 (2389)
Q Consensus       111 eIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaS-ggdD-V~IW~~~~s~Wecvwt~~~~~  187 (2389)
                      ++++ +.|+.|++|+-.      +..|.|..++.+ -.+..++.+.--..+.+ ++++ +.+|+.....--|.-.+.-+-
T Consensus        71 ~~vsG~sD~~v~lW~l~------~~~~~~i~~~~g-~~~~~~cv~a~~~~~~~~~ad~~v~vw~~~~~e~~~~~~~rf~~  143 (764)
T KOG1063|consen   71 EMVSGDSDGRVILWKLR------DEYLIKIYTIQG-HCKECVCVVARSSVMTCKAADGTVSVWDKQQDEVFLLAVLRFEI  143 (764)
T ss_pred             eEEEccCCCcEEEEEEe------ehheEEEEeecC-cceeEEEEEeeeeEEEeeccCceEEEeecCCCceeeehheehhh
Confidence            4665 468999999875      336999999987 55566666664444444 4555 889998555433322222111


Q ss_pred             cceEE--EEeecC-CCceEeeec-ccccccCCCCCCCceeEEEeeCCCccceee--cccCCCCeeEEEeccCCCCCCCCC
Q 000080          188 PQNLV--SATWSI-EGPSATAAS-MSQLDLLGPKEAGKCVFICCSDGKSEYIKL--ELCHPQPVSMVQWRPSTRRHSPGD  261 (2389)
Q Consensus       188 ~~~iv--svaWSp-dG~fATag~-dikf~~~~~~~~~kpV~V~~~dg~~~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~D  261 (2389)
                      .. ++  |.+-.| .|.++.+++ ..+            +...+.++...|..+  ..+|..-|.+++|+-.+     + 
T Consensus       144 k~-~ipLcL~~~~~~~~~lla~Ggs~~------------~v~~~s~~~d~f~~v~el~GH~DWIrsl~f~~~~-----~-  204 (764)
T KOG1063|consen  144 KE-AIPLCLAALKNNKTFLLACGGSKF------------VVDLYSSSADSFARVAELEGHTDWIRSLAFARLG-----G-  204 (764)
T ss_pred             hh-HhhHHHhhhccCCcEEEEecCcce------------EEEEeccCCcceeEEEEeeccchhhhhhhhhccC-----C-
Confidence            11 22  444455 566555544 322            111222222234443  47899999999998742     1 


Q ss_pred             CccccCceEEeeecCCeEEEEEeecCCccccccccc-----CCCCccceeEEEEEEEeecccccCCCCCCeEEEeecccc
Q 000080          262 TKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDT-----NDHKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIR  336 (2389)
Q Consensus       262 gk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~-----~d~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~  336 (2389)
                          ..-+|||||.|.+||||++...+..++.-...     .+.+.--+-+++---|+..+.+-|-=.==..|+|=....
T Consensus       205 ----~~~~laS~SQD~yIRiW~i~~~~~~~~~~~e~~~t~~~~~~~f~~l~~i~~~is~eall~GHeDWV~sv~W~p~~~  280 (764)
T KOG1063|consen  205 ----DDLLLASSSQDRYIRIWRIVLGDDEDSNEREDSLTTLSNLPVFMILEEIQYRISFEALLMGHEDWVYSVWWHPEGL  280 (764)
T ss_pred             ----CcEEEEecCCceEEEEEEEEecCCccccccccccccccCCceeeeeeeEEEEEehhhhhcCcccceEEEEEccchh
Confidence                24579999999999999999877654311110     011111111122222222242223223335677777776


Q ss_pred             ceeeccCCccceecccccccccceeeeee----EeecCCccceeEEEeeeccCCCCCcCeEEEeeeccccccCCCCCCCC
Q 000080          337 CMFETGEGANHFISTGVYEHGGTGKCEWL----VGYGPGSLVTLWAIHCLDDISPLRFPRVTLWKKQNLELEHPHNSGFS  412 (2389)
Q Consensus       337 ~vf~~~~e~~~~~~s~~~~~~~v~~~eW~----~~~~PGs~l~~W~v~~LDd~~~~R~prVt~~~r~~~~~~~~~~a~f~  412 (2389)
                      .+-+.+++++-.+=-++-   ++|  =|.    +|.--|+-+-||..+|--+                            
T Consensus       281 ~LLSASaDksmiiW~pd~---~tG--iWv~~vRlGe~gg~a~GF~g~lw~~n----------------------------  327 (764)
T KOG1063|consen  281 DLLSASADKSMIIWKPDE---NTG--IWVDVVRLGEVGGSAGGFWGGLWSPN----------------------------  327 (764)
T ss_pred             hheecccCcceEEEecCC---ccc--eEEEEEEeecccccccceeeEEEcCC----------------------------
Confidence            666666555422211110   000  021    1111144444555554332                            


Q ss_pred             CCcCccccceeEEeccccCCCCcccccccccccCcceeehhcccCCCCccccccCCCC-c-cceeeecccceeeeccccc
Q 000080          413 GFQGQSLLNKVVISRDCVSGLPTICSLVHLSHCNSLVWSLLHAQRSGDVEDVSSDKSS-T-GQILSCSASRILSIEGHTG  490 (2389)
Q Consensus       413 ~~~da~~l~~~vi~r~~~~g~p~~cs~~~l~~~N~~~~~~~h~~~sln~~~~s~~~~s-f-~~i~s~~~s~~~~~~GH~~  490 (2389)
                               .++|+-+                         ---|.+-+|-   ++++ | ..-..+        -||..
T Consensus       328 ---------~~~ii~~-------------------------g~~Gg~hlWk---t~d~~~w~~~~~i--------SGH~~  362 (764)
T KOG1063|consen  328 ---------SNVIIAH-------------------------GRTGGFHLWK---TKDKTFWTQEPVI--------SGHVD  362 (764)
T ss_pred             ---------CCEEEEe-------------------------cccCcEEEEe---ccCccceeecccc--------ccccc
Confidence                     0222211                         1223334454   2332 1 222223        79999


Q ss_pred             eEeEEeeeccccchhhhhccCCCccEEEEEecccccccCCCCCCCCccccccc------ccccccc-CCccceeeecccc
Q 000080          491 KILQVAVHPCVSEFELAVSLDSNGLLLFWSLSTISNCISDLPTLMPSWKLCGK------LRTRKSC-SNYTSLRWAPSLL  563 (2389)
Q Consensus       491 ~i~qv~~Hp~l~~l~Lt~S~d~~~~LilW~vspv~~~~~~~~~~~P~l~~~Gg------lar~~s~-~~ftsl~W~Psil  563 (2389)
                      -+.+|.-||.= |.+|++|+|--.-|.                 .| |   |+      +||--.- -.-+||+-++.  
T Consensus       363 ~V~dv~W~psG-eflLsvs~DQTTRlF-----------------a~-w---g~q~~wHEiaRPQiHGyDl~c~~~vn~--  418 (764)
T KOG1063|consen  363 GVKDVDWDPSG-EFLLSVSLDQTTRLF-----------------AR-W---GRQQEWHEIARPQIHGYDLTCLSFVNE--  418 (764)
T ss_pred             cceeeeecCCC-CEEEEeccccceeee-----------------cc-c---ccccceeeecccccccccceeeehccC--
Confidence            99999999999 999999999764332                 33 4   43      5554333 55566665554  


Q ss_pred             ccceEEEEeecCCeeEEEEeccccCCCCe--EeeeeEEEeccCCCCCCCCCceeeeecCCccCCcccccceEEEEEEeec
Q 000080          564 DEDMVLLMGHVGGIDCFIVKISQTEVDDI--VCHYVCTIPFTGHGHYEDGPANIFSVPLPSCNDKTVMYNKFMLLGVWLK  641 (2389)
Q Consensus       564 ~~~~~~fva~~gg~d~~l~~i~~~~~eni--t~~~~c~i~l~~~~~~~~~~~~ih~~p~~~~~~~tf~~n~f~lv~v~~~  641 (2389)
                         ..-||   +|+|.=+.+...--+ ++  ++...|-+.+-+.+.+.++-    +.|.=-.=+|.|..           
T Consensus       419 ---~~~FV---SgAdEKVlRvF~aPk-~fv~~l~~i~g~~~~~~~~~p~gA----~VpaLGLSnKa~~~-----------  476 (764)
T KOG1063|consen  419 ---DLQFV---SGADEKVLRVFEAPK-SFVKSLMAICGKCFKGSDELPDGA----NVPALGLSNKAFFP-----------  476 (764)
T ss_pred             ---Cceee---ecccceeeeeecCcH-HHHHHHHHHhCccccCchhccccc----ccccccccCCCCcc-----------
Confidence               33343   344443444331111 11  22222322232222222220    00100011111110           


Q ss_pred             ccceeEEEEEEeeecCCcccccCCCCCCccccccCCcccccccceeeeeeccccCcCCCCCCcccccEEEEeecCCCcCC
Q 000080          642 GLESLSWEITFHSFDLSESCCGCIDDNNTVKCSMCKFETTFCGKKYFIGVNPCSSQFPEPHTRNWVTSFAVVCPNNLVPM  721 (2389)
Q Consensus       642 ~f~~l~W~v~l~s~~~~~~~~~c~~~~~~~~~~~~~~~~s~a~k~~~l~~~~cs~~~P~~~l~~~v~s~~~v~p~~~~~~  721 (2389)
                                     .+++               ...   + +-       +|-+.-|    ....  ++.-.|    |+
T Consensus       477 ---------------~e~~---------------~G~---~-~~-------~~~et~~----~~~p--~~L~eP----P~  505 (764)
T KOG1063|consen  477 ---------------GETN---------------TGG---E-AA-------VCAETPL----AAAP--CELTEP----PT  505 (764)
T ss_pred             ---------------cccc---------------ccc---c-cc-------eeeeccc----ccCc--hhccCC----Ch
Confidence                           0000               000   0 00       1211111    0000  000012    11


Q ss_pred             CccccCCCCCCCCCCCeEEEEeecCCcEEEEEEEeCCCCCCceeeeeeeeeecCCCCceEEEeecCCCeEEEEccCCCCC
Q 000080          722 QQKLVYDNDPCSKIPPYTMATGYSDGSLRLWRSELGGSSTSCMPWELVGMLVAHQGPVSAISLTDGGRKIATVSAASHSN  801 (2389)
Q Consensus       722 ~~~l~s~~~~~~~~~pYliaT~CSDG~VRfWkc~v~~~~~~~y~We~w~ml~~~~G~p~~IS~a~tGR~a~a~~~~~~~~  801 (2389)
                      ..||-                                   ..-.|.|..-+-.|+=.+.++.++++|-++|..|+.++ .
T Consensus       506 EdqLq-----------------------------------~~tLwPEv~KLYGHGyEv~~l~~s~~gnliASaCKS~~-~  549 (764)
T KOG1063|consen  506 EDQLQ-----------------------------------QNTLWPEVHKLYGHGYEVYALAISPTGNLIASACKSSL-K  549 (764)
T ss_pred             HHHHH-----------------------------------HhccchhhHHhccCceeEEEEEecCCCCEEeehhhhCC-c
Confidence            11111                                   24569999888889989999999999999988887433 3


Q ss_pred             CccEEEEEeeccccCcceeEeeceeccCC-ceEEEEeEEccCCcEEEEEeecceEEEEEeccCCcccccccccccccccc
Q 000080          802 AVSNVRIWESVCVTELGSFVLEDTLSFDT-NIVAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSLKMQNW  880 (2389)
Q Consensus       802 ~~s~vsIWD~~~~sgGGswvLE~ti~ld~-~IVdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll~~~~w  880 (2389)
                      .-.-+-+|+.      +.|.--+.+.++. .|-+|.  ..+||..+|+|+=-+.+=||.+.+-+--.          .+.
T Consensus       550 ehAvI~lw~t------~~W~~~~~L~~HsLTVT~l~--FSpdg~~LLsvsRDRt~sl~~~~~~~~~e----------~~f  611 (764)
T KOG1063|consen  550 EHAVIRLWNT------ANWLQVQELEGHSLTVTRLA--FSPDGRYLLSVSRDRTVSLYEVQEDIKDE----------FRF  611 (764)
T ss_pred             cceEEEEEec------cchhhhheecccceEEEEEE--ECCCCcEEEEeecCceEEeeeeecccchh----------hhh
Confidence            3455999996      2588777777764 777994  57999999999999999999995543000          001


Q ss_pred             eeeccCCCCCccccccccCce-EEEEecCe
Q 000080          881 FCLAFSPTFAAHDFTWGRRAI-AIVVHQSY  909 (2389)
Q Consensus       881 ~~Id~~~T~hIgDssWVRDGI-LVVGmgnE  909 (2389)
                      .++ ..||--|=|=+|.||+. ++-++-.+
T Consensus       612 a~~-k~HtRIIWdcsW~pde~~FaTaSRDK  640 (764)
T KOG1063|consen  612 ACL-KAHTRIIWDCSWSPDEKYFATASRDK  640 (764)
T ss_pred             ccc-cccceEEEEcccCcccceeEEecCCc
Confidence            110 11222266678988887 66665543


No 93 
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.31  E-value=1.9e-11  Score=144.85  Aligned_cols=143  Identities=17%  Similarity=0.211  Sum_probs=120.6

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      -+|.+|+.||+.+++||||.|-...||++.+|.....+          +||.+.|+++.||.||.+||||+.+|.|++|+
T Consensus        65 ~svFavsl~P~~~l~aTGGgDD~AflW~~~~ge~~~el----------tgHKDSVt~~~FshdgtlLATGdmsG~v~v~~  134 (399)
T KOG0296|consen   65 DSVFAVSLHPNNNLVATGGGDDLAFLWDISTGEFAGEL----------TGHKDSVTCCSFSHDGTLLATGDMSGKVLVFK  134 (399)
T ss_pred             CceEEEEeCCCCceEEecCCCceEEEEEccCCcceeEe----------cCCCCceEEEEEccCceEEEecCCCccEEEEE
Confidence            35699999999999999999999999999999966655          46789999999999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      +.+++     ....+.+--..+.=+.++| -+.+|+.|   +.|+.|.+|.+  +.+...+.+.||..+++|=-+.|+|.
T Consensus       135 ~stg~-----~~~~~~~e~~dieWl~WHp-~a~illAG---~~DGsvWmw~i--p~~~~~kv~~Gh~~~ct~G~f~pdGK  203 (399)
T KOG0296|consen  135 VSTGG-----EQWKLDQEVEDIEWLKWHP-RAHILLAG---STDGSVWMWQI--PSQALCKVMSGHNSPCTCGEFIPDGK  203 (399)
T ss_pred             cccCc-----eEEEeecccCceEEEEecc-cccEEEee---cCCCcEEEEEC--CCcceeeEecCCCCCcccccccCCCc
Confidence            99974     2333332234444478899 88888864   79999999998  45466899999999999999999999


Q ss_pred             hhhc
Q 000080         2380 FALS 2383 (2389)
Q Consensus      2380 ~~~s 2383 (2389)
                      +++.
T Consensus       204 r~~t  207 (399)
T KOG0296|consen  204 RILT  207 (399)
T ss_pred             eEEE
Confidence            8764


No 94 
>KOG0306 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=99.30  E-value=1.2e-11  Score=155.13  Aligned_cols=137  Identities=18%  Similarity=0.209  Sum_probs=119.0

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecC-----CCcee--------eEecccCCCCCCCCCCCCCEEEEEECCCCCEE
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-----KDKAT--------ATYGVLPAANVPPPYALASISALQFDHYGHRF 2286 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~-----tGk~l--------~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L 2286 (2389)
                      ..|++++.+||+..+++||.|.||++||+.     .|...        +++. +          .+.|-+|++||||++|
T Consensus       455 gaIWsi~~~pD~~g~vT~saDktVkfWdf~l~~~~~gt~~k~lsl~~~rtLe-l----------~ddvL~v~~Spdgk~L  523 (888)
T KOG0306|consen  455 GAIWSISLSPDNKGFVTGSADKTVKFWDFKLVVSVPGTQKKVLSLKHTRTLE-L----------EDDVLCVSVSPDGKLL  523 (888)
T ss_pred             cceeeeeecCCCCceEEecCCcEEEEEeEEEEeccCcccceeeeeccceEEe-c----------cccEEEEEEcCCCcEE
Confidence            356999999999999999999999999974     12221        2332 1          2679999999999999


Q ss_pred             EEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec
Q 000080         2287 ASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus      2287 ASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
                      |.+=.|+||+++-+.+-     +-+.++-||.-+|.++..|| |+++|+|+   |.|++||||-+  .=|.|-++|-+|+
T Consensus       524 aVsLLdnTVkVyflDtl-----KFflsLYGHkLPV~smDIS~-DSklivTg---SADKnVKiWGL--dFGDCHKS~fAHd  592 (888)
T KOG0306|consen  524 AVSLLDNTVKVYFLDTL-----KFFLSLYGHKLPVLSMDISP-DSKLIVTG---SADKNVKIWGL--DFGDCHKSFFAHD  592 (888)
T ss_pred             EEEeccCeEEEEEecce-----eeeeeecccccceeEEeccC-CcCeEEec---cCCCceEEecc--ccchhhhhhhccc
Confidence            99999999999999874     67889999999999999999 99999996   69999999998  4588999999999


Q ss_pred             CcEEEEeecccc
Q 000080         2367 GLYDLFLPLKLL 2378 (2389)
Q Consensus      2367 ~~V~svA~~~~~ 2378 (2389)
                      +.|.+|-+.|+-
T Consensus       593 DSvm~V~F~P~~  604 (888)
T KOG0306|consen  593 DSVMSVQFLPKT  604 (888)
T ss_pred             CceeEEEEcccc
Confidence            999999988864


No 95 
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=99.26  E-value=1.5e-11  Score=147.21  Aligned_cols=153  Identities=14%  Similarity=0.173  Sum_probs=124.8

Q ss_pred             eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCcee-----eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC
Q 000080         2220 ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKAT-----ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus      2220 i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l-----~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
                      -+|.++.|++++. .||||+.|..||||-+.++..-     ..|..      ...+|...|+.|.|+|+|..||||+++|
T Consensus        14 ~pv~s~dfq~n~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s------~Ls~H~~aVN~vRf~p~gelLASg~D~g   87 (434)
T KOG1009|consen   14 EPVYSVDFQKNSLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLS------SLSRHTRAVNVVRFSPDGELLASGGDGG   87 (434)
T ss_pred             CceEEEEeccCcccceecccCccceeeeeeeecCCCCCceeEEEee------cccCCcceeEEEEEcCCcCeeeecCCCc
Confidence            3568899999988 9999999999999998755421     12210      1346789999999999999999999999


Q ss_pred             cEEEeeCC--------CCC---ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080         2294 TVCTWQLE--------VGG---RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus      2294 TVkLWDl~--------tgg---rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
                      .|-||..+        +..   +..-...+.+.+|...|++++|+| |+..++++   +-|+++++||+  ..|+.++.+
T Consensus        88 ~v~lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~h~~diydL~Ws~-d~~~l~s~---s~dns~~l~Dv--~~G~l~~~~  161 (434)
T KOG1009|consen   88 EVFLWKQGDVRIFDADTEADLNKEKWVVKKVLRGHRDDIYDLAWSP-DSNFLVSG---SVDNSVRLWDV--HAGQLLAIL  161 (434)
T ss_pred             eEEEEEecCcCCccccchhhhCccceEEEEEecccccchhhhhccC-CCceeeee---eccceEEEEEe--ccceeEeec
Confidence            99999776        200   000123466888999999999999 99999986   69999999998  567888999


Q ss_pred             EeecCcEEEEeecccchhhhcc
Q 000080         2363 TCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2363 ~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      .+|.+-|.-+|-.|...++.|+
T Consensus       162 ~dh~~yvqgvawDpl~qyv~s~  183 (434)
T KOG1009|consen  162 DDHEHYVQGVAWDPLNQYVASK  183 (434)
T ss_pred             cccccccceeecchhhhhhhhh
Confidence            9999999999999999888775


No 96 
>KOG0772 consensus Uncharacterized conserved protein, contains WD40 repeat [Function unknown]
Probab=99.26  E-value=5.4e-11  Score=144.88  Aligned_cols=298  Identities=15%  Similarity=0.181  Sum_probs=187.4

Q ss_pred             CCCCCCCCcccccccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccc--ccccceeeeeccCC
Q 000080           16 CVDPTEHLPLAFLRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEAL--IGPIFRQVFALSDN   93 (2389)
Q Consensus        16 ~~~~~~~lpl~~~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~--~~p~~~Qviegh~d   93 (2389)
                      .++|+-..|.+-   ++-=+.+|+.+.|++.-|.  | ..++-|+=+--|-.|      +|+-+  .=+.|||+.|--.|
T Consensus       148 e~~~~~~IP~sh---Ei~l~hgtk~Vsal~~Dp~--G-aR~~sGs~Dy~v~~w------Df~gMdas~~~fr~l~P~E~h  215 (641)
T KOG0772|consen  148 EESIIKLIPGSH---EIQLKHGTKIVSALAVDPS--G-ARFVSGSLDYTVKFW------DFQGMDASMRSFRQLQPCETH  215 (641)
T ss_pred             hhchhhcCCccc---eEeccCCceEEEEeeecCC--C-ceeeeccccceEEEE------ecccccccchhhhccCccccc
Confidence            445555555543   2223456788888888766  8 578888888888888      44321  12669999988777


Q ss_pred             CCCeeEEEEcCCCCCCCcEEE-ecCCeEEEEeeCC----CCCCCC-ccceeeEEecccceEEEEeecCCCC-eEEEEecc
Q 000080           94 SLPVTSISWSPETPSIGQLAA-ASENCIFVFAHDS----ASSKGS-FCWSQNAILVQGTKVEAIEWTGSGD-GIVAGGME  166 (2389)
Q Consensus        94 ~~dVk~VaWSPd~~~~GeIaA-SyDntIRVw~~d~----~~~kgd-~~W~~~~tL~hssTV~sIAWSpdG~-rLaSggdD  166 (2389)
                        +|.+++|||.   ++.|++ |..-.++|+.+|.    +..+|+ |--....+-.|...+.+-.|.|..+ ..++||.|
T Consensus       216 --~i~sl~ys~T---g~~iLvvsg~aqakl~DRdG~~~~e~~KGDQYI~Dm~nTKGHia~lt~g~whP~~k~~FlT~s~D  290 (641)
T KOG0772|consen  216 --QINSLQYSVT---GDQILVVSGSAQAKLLDRDGFEIVEFSKGDQYIRDMYNTKGHIAELTCGCWHPDNKEEFLTCSYD  290 (641)
T ss_pred             --ccceeeecCC---CCeEEEEecCcceeEEccCCceeeeeeccchhhhhhhccCCceeeeeccccccCcccceEEecCC
Confidence              8999999997   677775 5667899998872    112222 1111122334899999999999987 45699998


Q ss_pred             --eEEeeccCC-cEEEEEEeeccccc--eEEEEeecCCCc-eEeeecccccccCCC-CCCCceeEEEeeCCCccceeecc
Q 000080          167 --TVLWKKKNT-LWEIAWKFKENYPQ--NLVSATWSIEGP-SATAASMSQLDLLGP-KEAGKCVFICCSDGKSEYIKLEL  239 (2389)
Q Consensus       167 --V~IW~~~~s-~Wecvwt~~~~~~~--~ivsvaWSpdG~-fATag~dikf~~~~~-~~~~kpV~V~~~dg~~~~~~ve~  239 (2389)
                        ++||+.++. +-..|.+.++++.-  ++-+++|+|||+ ||+++.|..++.|.. +-...|           .-++..
T Consensus       291 gtlRiWdv~~~k~q~qVik~k~~~g~Rv~~tsC~~nrdg~~iAagc~DGSIQ~W~~~~~~v~p-----------~~~vk~  359 (641)
T KOG0772|consen  291 GTLRIWDVNNTKSQLQVIKTKPAGGKRVPVTSCAWNRDGKLIAAGCLDGSIQIWDKGSRTVRP-----------VMKVKD  359 (641)
T ss_pred             CcEEEEecCCchhheeEEeeccCCCcccCceeeecCCCcchhhhcccCCceeeeecCCccccc-----------ceEeee
Confidence              999996543 34445444444433  344889999999 999999877666521 111122           235678


Q ss_pred             cCCC--CeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCccccccccc-CCCCccceeEEEEEEEeec
Q 000080          240 CHPQ--PVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDT-NDHKTIRRSFCVGAIIEIN  316 (2389)
Q Consensus       240 aH~q--dVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~-~d~~~~~~sF~vaA~I~~~  316 (2389)
                      ||..  +|.||.+++        ||+.     |+|=+.|+|.|+|+..-.-++=+....- +--+++.|-|..=+-+=+-
T Consensus       360 AH~~g~~Itsi~FS~--------dg~~-----LlSRg~D~tLKvWDLrq~kkpL~~~tgL~t~~~~tdc~FSPd~kli~T  426 (641)
T KOG0772|consen  360 AHLPGQDITSISFSY--------DGNY-----LLSRGFDDTLKVWDLRQFKKPLNVRTGLPTPFPGTDCCFSPDDKLILT  426 (641)
T ss_pred             ccCCCCceeEEEecc--------ccch-----hhhccCCCceeeeeccccccchhhhcCCCccCCCCccccCCCceEEEe
Confidence            9986  999999999        6666     9999999999999987532221100000 1123345666544333200


Q ss_pred             --ccccCCCCCCeEEEeeccccceeeccCCccceecccccccccceeeeee
Q 000080          317 --QALNGALGMDIVITWAKEIRCMFETGEGANHFISTGVYEHGGTGKCEWL  365 (2389)
Q Consensus       317 --~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~~~~s~~~~~~~v~~~eW~  365 (2389)
                        -..||+--..+++.=.+--+.||+++-           ...-|-.|.|+
T Consensus       427 GtS~~~~~~~g~L~f~d~~t~d~v~ki~i-----------~~aSvv~~~Wh  466 (641)
T KOG0772|consen  427 GTSAPNGMTAGTLFFFDRMTLDTVYKIDI-----------STASVVRCLWH  466 (641)
T ss_pred             cccccCCCCCceEEEEeccceeeEEEecC-----------CCceEEEEeec
Confidence              112222222344433444455555542           23567889998


No 97 
>KOG1407 consensus WD40 repeat protein [Function unknown]
Probab=99.25  E-value=7.1e-11  Score=135.67  Aligned_cols=177  Identities=15%  Similarity=0.101  Sum_probs=135.5

Q ss_pred             ccccccceeecccccccccccccc--CCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc-cCCCC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVD--PPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV-LPAAN 2264 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d--~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v-l~gh~ 2264 (2389)
                      |-+-+..|+. .-++..++|++..  +.+.+++ ..=.-++|+|+|.+++.|+.|-.|..-|.++-+.+.+++. ...+.
T Consensus        74 ~~~~d~~ata-s~dk~ir~wd~r~~k~~~~i~~~~eni~i~wsp~g~~~~~~~kdD~it~id~r~~~~~~~~~~~~e~ne  152 (313)
T KOG1407|consen   74 PKHPDLFATA-SGDKTIRIWDIRSGKCTARIETKGENINITWSPDGEYIAVGNKDDRITFIDARTYKIVNEEQFKFEVNE  152 (313)
T ss_pred             CCCCcceEEe-cCCceEEEEEeccCcEEEEeeccCcceEEEEcCCCCEEEEecCcccEEEEEecccceeehhcccceeee
Confidence            4445566666 5588899998862  2222222 1113569999999999999999999999876655433210 00000


Q ss_pred             ------------------------------CCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080         2265 ------------------------------VPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus      2265 ------------------------------~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
                                                    .....|...-.+|.|+|+|++||+||.|-.|.|||++.-     -+.+.+
T Consensus       153 ~~w~~~nd~Fflt~GlG~v~ILsypsLkpv~si~AH~snCicI~f~p~GryfA~GsADAlvSLWD~~EL-----iC~R~i  227 (313)
T KOG1407|consen  153 ISWNNSNDLFFLTNGLGCVEILSYPSLKPVQSIKAHPSNCICIEFDPDGRYFATGSADALVSLWDVDEL-----ICERCI  227 (313)
T ss_pred             eeecCCCCEEEEecCCceEEEEeccccccccccccCCcceEEEEECCCCceEeeccccceeeccChhHh-----hhheee
Confidence                                          013457788889999999999999999999999999853     567777


Q ss_pred             eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      .-|.-+|+.+.||. ||++||||   |+|.-|-|=++  ++|..++.++ |++...+||-+|+-
T Consensus       228 sRldwpVRTlSFS~-dg~~lASa---SEDh~IDIA~v--etGd~~~eI~-~~~~t~tVAWHPk~  284 (313)
T KOG1407|consen  228 SRLDWPVRTLSFSH-DGRMLASA---SEDHFIDIAEV--ETGDRVWEIP-CEGPTFTVAWHPKR  284 (313)
T ss_pred             ccccCceEEEEecc-Ccceeecc---CccceEEeEec--ccCCeEEEee-ccCCceeEEecCCC
Confidence            88999999999999 99999997   79999999887  7888899988 88889999988863


No 98 
>KOG2445 consensus Nuclear pore complex component (sc Seh1) [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=99.23  E-value=6e-10  Score=130.33  Aligned_cols=264  Identities=17%  Similarity=0.261  Sum_probs=170.4

Q ss_pred             eccCCCCCeeEEEEcCCCCCCCcEEE-ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCC--CCeEEEEe
Q 000080           89 ALSDNSLPVTSISWSPETPSIGQLAA-ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGS--GDGIVAGG  164 (2389)
Q Consensus        89 egh~d~~dVk~VaWSPd~~~~GeIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpd--G~rLaSgg  164 (2389)
                      .+|+|  -|.+|.|-+.   |..+|+ |+|.+|+||..+    +++-.|.|+..-. |++.||.|.|-+-  |+-+|+|+
T Consensus        10 s~h~D--lihdVs~D~~---GRRmAtCSsDq~vkI~d~~----~~s~~W~~Ts~Wrah~~Si~rV~WAhPEfGqvvA~cS   80 (361)
T KOG2445|consen   10 SGHKD--LIHDVSFDFY---GRRMATCSSDQTVKIWDST----SDSGTWSCTSSWRAHDGSIWRVVWAHPEFGQVVATCS   80 (361)
T ss_pred             cCCcc--eeeeeeeccc---CceeeeccCCCcEEEEecc----CCCCceEEeeeEEecCCcEEEEEecCccccceEEEEe
Confidence            56777  7999999997   666775 579999999954    2334799988884 9999999999875  89999999


Q ss_pred             cc--eEEeec-------cCCcEEEEEEeeccccceEEEEeecCC--Cc-eEeeecccc---cccCCCCCCCceeEEEeeC
Q 000080          165 ME--TVLWKK-------KNTLWEIAWKFKENYPQNLVSATWSIE--GP-SATAASMSQ---LDLLGPKEAGKCVFICCSD  229 (2389)
Q Consensus       165 dD--V~IW~~-------~~s~Wecvwt~~~~~~~~ivsvaWSpd--G~-fATag~dik---f~~~~~~~~~kpV~V~~~d  229 (2389)
                      .|  +.||..       ....|...+++. +....+++|.++|-  |. +|+|+.|.-   |+.-+..+-  .-|-.  .
T Consensus        81 ~Drtv~iWEE~~~~~~~~~~~Wv~~ttl~-DsrssV~DV~FaP~hlGLklA~~~aDG~lRIYEA~dp~nL--s~W~L--q  155 (361)
T KOG2445|consen   81 YDRTVSIWEEQEKSEEAHGRRWVRRTTLV-DSRSSVTDVKFAPKHLGLKLAAASADGILRIYEAPDPMNL--SQWTL--Q  155 (361)
T ss_pred             cCCceeeeeecccccccccceeEEEEEee-cCCcceeEEEecchhcceEEEEeccCcEEEEEecCCcccc--ccchh--h
Confidence            98  999996       224798888765 34456789999994  88 999999654   332211111  11211  1


Q ss_pred             CCcc-ceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecC-----CeEEEEEeecCC-ccccccc--ccCC-
Q 000080          230 GKSE-YIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLD-----GTVRLWCEMDSG-KTRKVAK--DTND-  299 (2389)
Q Consensus       230 g~~~-~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdD-----gTVRLW~e~d~G-k~kk~~~--~~~d-  299 (2389)
                      .+.+ .......|.++-.||.|+|+  +|        .+..||-+|++     +.++||...++| |.+|-++  +..| 
T Consensus       156 ~Ei~~~~~pp~~~~~~~~CvsWn~s--r~--------~~p~iAvgs~e~a~~~~~~~Iye~~e~~rKw~kva~L~d~~dp  225 (361)
T KOG2445|consen  156 HEIQNVIDPPGKNKQPCFCVSWNPS--RM--------HEPLIAVGSDEDAPHLNKVKIYEYNENGRKWLKVAELPDHTDP  225 (361)
T ss_pred             hhhhhccCCcccccCcceEEeeccc--cc--------cCceEEEEcccCCccccceEEEEecCCcceeeeehhcCCCCCc
Confidence            1111 11123568899999999984  33        45568888888     689999999998 6655332  2222 


Q ss_pred             ------CCccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeeccCCccc-------eecccccccc-cceeeeee
Q 000080          300 ------HKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETGEGANH-------FISTGVYEHG-GTGKCEWL  365 (2389)
Q Consensus       300 ------~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~~e~~~-------~~~s~~~~~~-~v~~~eW~  365 (2389)
                            -++.+++||++|+--    ..| .++ |.|.=+  -+-++.-+.+++.       ...++.-+|. +|=.++|+
T Consensus       226 I~di~wAPn~Gr~y~~lAvA~----kDg-v~I-~~v~~~--~s~i~~ee~~~~~~~~~l~v~~vs~~~~H~~~VWrv~wN  297 (361)
T KOG2445|consen  226 IRDISWAPNIGRSYHLLAVAT----KDG-VRI-FKVKVA--RSAIEEEEVLAPDLMTDLPVEKVSELDDHNGEVWRVRWN  297 (361)
T ss_pred             ceeeeeccccCCceeeEEEee----cCc-EEE-EEEeec--cchhhhhcccCCCCccccceEEeeeccCCCCceEEEEEe
Confidence                  346799999999965    444 211 222110  0111111111111       1123344664 88899998


Q ss_pred             ------EeecCCccceeEEEeeecc
Q 000080          366 ------VGYGPGSLVTLWAIHCLDD  384 (2389)
Q Consensus       366 ------~~~~PGs~l~~W~v~~LDd  384 (2389)
                            .+-|--..+++|..-+-|.
T Consensus       298 mtGtiLsStGdDG~VRLWkany~n~  322 (361)
T KOG2445|consen  298 MTGTILSSTGDDGCVRLWKANYNNL  322 (361)
T ss_pred             eeeeEEeecCCCceeeehhhhhhhh
Confidence                  3444434556777666554


No 99 
>KOG0302 consensus Ribosome Assembly protein [General function prediction only]
Probab=99.23  E-value=4.3e-11  Score=142.11  Aligned_cols=147  Identities=19%  Similarity=0.252  Sum_probs=117.3

Q ss_pred             EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeC
Q 000080         2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl 2300 (2389)
                      .+++|||--. .|+||-.-+.|++|...+|.=...       ..|..||+..|-.+++||.- ..|||||.||+|||||+
T Consensus       215 y~LdWSp~~~g~LlsGDc~~~I~lw~~~~g~W~vd-------~~Pf~gH~~SVEDLqWSptE~~vfaScS~DgsIrIWDi  287 (440)
T KOG0302|consen  215 YGLDWSPIKTGRLLSGDCVKGIHLWEPSTGSWKVD-------QRPFTGHTKSVEDLQWSPTEDGVFASCSCDGSIRIWDI  287 (440)
T ss_pred             eeeecccccccccccCccccceEeeeeccCceeec-------CccccccccchhhhccCCccCceEEeeecCceEEEEEe
Confidence            6789999322 478888888999999988753221       23678899999999999984 79999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC-CCCCceEEEEeecCcEEEEeecc--c
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-PPTSSRASITCHEGLYDLFLPLK--L 2377 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-~tg~~v~sL~GH~~~V~svA~~~--~ 2377 (2389)
                      +.+.+   ++......|.+-|+-|.|+. .-.+||||   ++|||++|||+.. ..++.|..|.-|...|+||..+|  +
T Consensus       288 Rs~~~---~~~~~~kAh~sDVNVISWnr-~~~lLasG---~DdGt~~iwDLR~~~~~~pVA~fk~Hk~pItsieW~p~e~  360 (440)
T KOG0302|consen  288 RSGPK---KAAVSTKAHNSDVNVISWNR-REPLLASG---GDDGTLSIWDLRQFKSGQPVATFKYHKAPITSIEWHPHED  360 (440)
T ss_pred             cCCCc---cceeEeeccCCceeeEEccC-Ccceeeec---CCCceEEEEEhhhccCCCcceeEEeccCCeeEEEeccccC
Confidence            98732   34444488999999999998 55699996   4999999999852 34456899999999999998776  4


Q ss_pred             chhhhc
Q 000080         2378 LNFALS 2383 (2389)
Q Consensus      2378 ~~~~~s 2383 (2389)
                      ..+|.|
T Consensus       361 s~iaas  366 (440)
T KOG0302|consen  361 SVIAAS  366 (440)
T ss_pred             ceEEec
Confidence            444443


No 100
>KOG1064 consensus RAVE (regulator of V-ATPase assembly) complex subunit RAV1/DMX protein, WD repeat superfamily [General function prediction only]
Probab=99.23  E-value=1.4e-08  Score=136.04  Aligned_cols=193  Identities=11%  Similarity=0.131  Sum_probs=140.3

Q ss_pred             CCCCCCCCCcccccccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCC
Q 000080           15 PCVDPTEHLPLAFLRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNS   94 (2389)
Q Consensus        15 ~~~~~~~~lpl~~~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~   94 (2389)
                      +++.-++++|+..-.+..-++.++.+-.++.|.|+++...|.+||..|...+-.|+.+..+...+.+|++  +.+.... 
T Consensus        18 y~~gsi~~~pftay~sg~~vvIl~n~fervQiIp~~~~g~~~vsav~c~~~tG~IA~sygn~v~I~eP~~--i~s~k~n-   94 (2439)
T KOG1064|consen   18 YSVGSIGDLPFTAYASGCDVVILTNDFERVQIIPGAKHGNILVSAVDCSQQTGKIAASYGNVVSIFEPTN--ILSSKGN-   94 (2439)
T ss_pred             ceeceECCeeEEEeecCCceEEEcCCceeEEeccccCcCceEEEEEeeccccceeeeccCCeeeecCCcc--hhhhcCC-
Confidence            4666799999999999999999999999999999998878999999999999999999999888889998  2222222 


Q ss_pred             CCeeEEEEcCCCCCCCcE-------------EEecCCeEEEEeeCC-------C-CC----CCCccceeeEEecccceEE
Q 000080           95 LPVTSISWSPETPSIGQL-------------AAASENCIFVFAHDS-------A-SS----KGSFCWSQNAILVQGTKVE  149 (2389)
Q Consensus        95 ~dVk~VaWSPd~~~~GeI-------------aASyDntIRVw~~d~-------~-~~----kgd~~W~~~~tL~hssTV~  149 (2389)
                       ++..+.|.+.|+..++.             ++.+++.+.+|.+-.       + -+    ...-+|.+.++......|-
T Consensus        95 -~~~~~~W~~t~qf~~~~~~~s~~w~~~~~rlltgs~~l~Lwq~~~~~~~~~~~~i~d~~l~~~~~We~iW~~k~~~~v~  173 (2439)
T KOG1064|consen   95 -PHLAVQWVQTTQFFHDSTVVSLNWNFEGLRLLTGSDNLQLWQETINFSIEEPEEITDTVLPKRRDWELIWSCKTPSPVY  173 (2439)
T ss_pred             -cceeeeEEeeecccccccceeeeeccccchhhhcCcceEEEeccCCcccccccccccccccccccceEEEeccCCccee
Confidence             33444444443333332             223357888995421       0 00    0112588888877777799


Q ss_pred             EEeecCCCCeEEEEecc---eEEeeccC-------CcEEEEEEeeccccceEEEEeec------CCCc----eEeeeccc
Q 000080          150 AIEWTGSGDGIVAGGME---TVLWKKKN-------TLWEIAWKFKENYPQNLVSATWS------IEGP----SATAASMS  209 (2389)
Q Consensus       150 sIAWSpdG~rLaSggdD---V~IW~~~~-------s~Wecvwt~~~~~~~~ivsvaWS------pdG~----fATag~di  209 (2389)
                      .+.|||||.++|++|.+   +++|.+.+       ..+..   +...||+.|--+.|.      |.|.    +-|||-|.
T Consensus       174 ~~~~SpDG~f~at~g~~dclaKvwy~~~~~~~~~~~~f~~---vyL~HP~~Vs~~~WRktskymp~gsv~nvL~T~C~D~  250 (2439)
T KOG1064|consen  174 SSTISPDGEFFATIGKRDCLAKVWYKSTVSQSGGEESFSF---VYLPHPRRVSGFQWRKTSKYMPRGSVSNVLMTCCLDN  250 (2439)
T ss_pred             EEEEcCCcceEEeccccCcchhhhcccccccccCccceee---EeccCCcccccceeccccccCCccchhhhHHhhhccC
Confidence            99999999999999996   89999421       22333   357899988888888      5554    77787765


Q ss_pred             ccccC
Q 000080          210 QLDLL  214 (2389)
Q Consensus       210 kf~~~  214 (2389)
                      ..++|
T Consensus       251 v~RIW  255 (2439)
T KOG1064|consen  251 VCRIW  255 (2439)
T ss_pred             ceEEE
Confidence            53443


No 101
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=99.23  E-value=5.7e-11  Score=144.02  Aligned_cols=152  Identities=22%  Similarity=0.316  Sum_probs=125.2

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..|.+++-+|+|.+|+.|..-+.|+||.+.+|..+.++.   +|       =..|+++.|+-||..|.|||.||.|.+|+
T Consensus        82 g~v~al~s~n~G~~l~ag~i~g~lYlWelssG~LL~v~~---aH-------YQ~ITcL~fs~dgs~iiTgskDg~V~vW~  151 (476)
T KOG0646|consen   82 GPVHALASSNLGYFLLAGTISGNLYLWELSSGILLNVLS---AH-------YQSITCLKFSDDGSHIITGSKDGAVLVWL  151 (476)
T ss_pred             cceeeeecCCCceEEEeecccCcEEEEEeccccHHHHHH---hh-------ccceeEEEEeCCCcEEEecCCCccEEEEE
Confidence            347999999999999999899999999999999988774   44       47899999999999999999999999998


Q ss_pred             CCCCC----ccCcccceeeeecCCCeeEEEEecC-CCCEEEEeecCCCCCeEEEeeC-----------------------
Q 000080         2300 LEVGG----RSNVRPMESCLCFSSHAMDVSYITS-SGSVIAAAGHSSNGINVVVWDT----------------------- 2351 (2389)
Q Consensus      2300 l~tgg----rs~~k~l~tl~gHs~~V~sVAFSP~-DGslLASAG~sS~D~TVrLWD~----------------------- 2351 (2389)
                      +.+--    ...++|+..+..|.-.|.++-..++ ...+|+|+   |.|+|+|+||+                       
T Consensus       152 l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~Ta---S~D~t~k~wdlS~g~LLlti~fp~si~av~lDpa  228 (476)
T KOG0646|consen  152 LTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTA---SEDRTIKLWDLSLGVLLLTITFPSSIKAVALDPA  228 (476)
T ss_pred             EEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEe---cCCceEEEEEeccceeeEEEecCCcceeEEEccc
Confidence            74310    0146789999999999999877763 33678887   69999999995                       


Q ss_pred             --------------------CC------------CCCCceEEEEeecC--cEEEEeecccchhhhcc
Q 000080         2352 --------------------LA------------PPTSSRASITCHEG--LYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2352 --------------------l~------------~tg~~v~sL~GH~~--~V~svA~~~~~~~~~s~ 2384 (2389)
                                          ..            ..+..++.+.||++  .|+|+|.+.||.-.+|-
T Consensus       229 e~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~DgtlLlSG  295 (476)
T KOG0646|consen  229 ERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAISTDGTLLLSG  295 (476)
T ss_pred             ccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEecCccEEEee
Confidence                                01            12334667899999  99999999999877763


No 102
>KOG0301 consensus Phospholipase A2-activating protein (contains WD40 repeats) [Lipid transport and metabolism]
Probab=99.22  E-value=4.1e-11  Score=149.78  Aligned_cols=132  Identities=12%  Similarity=0.139  Sum_probs=110.6

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      -+++-.-++. ++|||.|.|+|+|-.  |++..+++          ||.+.|++|++=|++ .++|||.|.|||+|.-. 
T Consensus       105 C~ls~~~~~~-~iSgSWD~TakvW~~--~~l~~~l~----------gH~asVWAv~~l~e~-~~vTgsaDKtIklWk~~-  169 (745)
T KOG0301|consen  105 CSLSIGEDGT-LISGSWDSTAKVWRI--GELVYSLQ----------GHTASVWAVASLPEN-TYVTGSADKTIKLWKGG-  169 (745)
T ss_pred             eeeecCCcCc-eEecccccceEEecc--hhhhcccC----------CcchheeeeeecCCC-cEEeccCcceeeeccCC-
Confidence            5666666666 999999999999986  57776652          577999999999998 99999999999999653 


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                            +.+.++.||++.|+.+++.+ ++.+| |+   +.|+.||+||+   ++.++....||++-|.+++....+.-++
T Consensus       170 ------~~l~tf~gHtD~VRgL~vl~-~~~fl-Sc---sNDg~Ir~w~~---~ge~l~~~~ghtn~vYsis~~~~~~~Iv  235 (745)
T KOG0301|consen  170 ------TLLKTFSGHTDCVRGLAVLD-DSHFL-SC---SNDGSIRLWDL---DGEVLLEMHGHTNFVYSISMALSDGLIV  235 (745)
T ss_pred             ------chhhhhccchhheeeeEEec-CCCeE-ee---cCCceEEEEec---cCceeeeeeccceEEEEEEecCCCCeEE
Confidence                  46788999999999999998 65655 65   59999999997   6899999999999999999555555444


Q ss_pred             c
Q 000080         2383 S 2383 (2389)
Q Consensus      2383 s 2383 (2389)
                      |
T Consensus       236 s  236 (745)
T KOG0301|consen  236 S  236 (745)
T ss_pred             E
Confidence            4


No 103
>KOG0296 consensus Angio-associated migratory cell protein (contains WD40 repeats) [Function unknown]
Probab=99.22  E-value=1.1e-10  Score=138.48  Aligned_cols=145  Identities=14%  Similarity=0.222  Sum_probs=117.3

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .=+.|||-+++|+.|+.||.|-+|.+.++...+.|.          ||...+++=.|.|||+++++|..||||++||+.+
T Consensus       152 eWl~WHp~a~illAG~~DGsvWmw~ip~~~~~kv~~----------Gh~~~ct~G~f~pdGKr~~tgy~dgti~~Wn~kt  221 (399)
T KOG0296|consen  152 EWLKWHPRAHILLAGSTDGSVWMWQIPSQALCKVMS----------GHNSPCTCGEFIPDGKRILTGYDDGTIIVWNPKT  221 (399)
T ss_pred             EEEEecccccEEEeecCCCcEEEEECCCcceeeEec----------CCCCCcccccccCCCceEEEEecCceEEEEecCC
Confidence            446999999999999999999999998876666662          5678899999999999999999999999999988


Q ss_pred             CCc-----------------------------------------------------------------------------
Q 000080         2303 GGR----------------------------------------------------------------------------- 2305 (2389)
Q Consensus      2303 ggr----------------------------------------------------------------------------- 2305 (2389)
                      +..                                                                             
T Consensus       222 g~p~~~~~~~e~~~~~~~~~~~~~~~~~~g~~e~~~~~~~~~sgKVv~~~n~~~~~l~~~~e~~~esve~~~~ss~lpL~  301 (399)
T KOG0296|consen  222 GQPLHKITQAEGLELPCISLNLAGSTLTKGNSEGVACGVNNGSGKVVNCNNGTVPELKPSQEELDESVESIPSSSKLPLA  301 (399)
T ss_pred             CceeEEecccccCcCCccccccccceeEeccCCccEEEEccccceEEEecCCCCccccccchhhhhhhhhcccccccchh
Confidence            621                                                                             


Q ss_pred             -------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2306 -------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2306 -------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                                   .....++..-.|+..|..+-|.+ + .+|+|+   +.|++||+||.  .+|+++..+.||..+|.++
T Consensus       302 A~G~vdG~i~iyD~a~~~~R~~c~he~~V~~l~w~~-t-~~l~t~---c~~g~v~~wDa--RtG~l~~~y~GH~~~Il~f  374 (399)
T KOG0296|consen  302 ACGSVDGTIAIYDLAASTLRHICEHEDGVTKLKWLN-T-DYLLTA---CANGKVRQWDA--RTGQLKFTYTGHQMGILDF  374 (399)
T ss_pred             hcccccceEEEEecccchhheeccCCCceEEEEEcC-c-chheee---ccCceEEeeec--cccceEEEEecCchheeEE
Confidence                         00001111123777788888887 4 556654   58889999997  5899999999999999999


Q ss_pred             eecccchhhhcc
Q 000080         2373 LPLKLLNFALSK 2384 (2389)
Q Consensus      2373 A~~~~~~~~~s~ 2384 (2389)
                      +.+|++++.++-
T Consensus       375 ~ls~~~~~vvT~  386 (399)
T KOG0296|consen  375 ALSPQKRLVVTV  386 (399)
T ss_pred             EEcCCCcEEEEe
Confidence            999999998863


No 104
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.20  E-value=9.2e-11  Score=137.29  Aligned_cols=137  Identities=20%  Similarity=0.249  Sum_probs=112.1

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEee
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLWD 2299 (2389)
                      +.+||.  +|+++||||.|-||+|||..+.+++.++-          -|.+.|+++.|.|+-.  .|.||++||.|.+|+
T Consensus        46 itavAV--s~~~~aSGssDetI~IYDm~k~~qlg~ll----------~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~  113 (362)
T KOG0294|consen   46 ITALAV--SGPYVASGSSDETIHIYDMRKRKQLGILL----------SHAGSITALKFYPPLSKSHLLSGSDDGHIIIWR  113 (362)
T ss_pred             eeEEEe--cceeEeccCCCCcEEEEeccchhhhccee----------ccccceEEEEecCCcchhheeeecCCCcEEEEE
Confidence            366666  58999999999999999998888877763          2678999999999975  999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEEEEeeccc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      +..-     ..+.++.+|.+.|++++.+| +|++-.|.|   .|+++|+||+.  .|+.  +..|. |  ..+.|.++|+
T Consensus       114 ~~~W-----~~~~slK~H~~~Vt~lsiHP-S~KLALsVg---~D~~lr~WNLV--~Gr~a~v~~L~-~--~at~v~w~~~  179 (362)
T KOG0294|consen  114 VGSW-----ELLKSLKAHKGQVTDLSIHP-SGKLALSVG---GDQVLRTWNLV--RGRVAFVLNLK-N--KATLVSWSPQ  179 (362)
T ss_pred             cCCe-----EEeeeecccccccceeEecC-CCceEEEEc---CCceeeeehhh--cCccceeeccC-C--cceeeEEcCC
Confidence            9865     47788999999999999999 999888875   89999999985  3333  33332 2  2445889999


Q ss_pred             ch-hhhcc
Q 000080         2378 LN-FALSK 2384 (2389)
Q Consensus      2378 ~~-~~~s~ 2384 (2389)
                      |+ |+++-
T Consensus       180 Gd~F~v~~  187 (362)
T KOG0294|consen  180 GDHFVVSG  187 (362)
T ss_pred             CCEEEEEe
Confidence            98 76653


No 105
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.20  E-value=4.5e-11  Score=144.70  Aligned_cols=144  Identities=16%  Similarity=0.171  Sum_probs=117.7

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec----ccCCCCCC--CC--CCCCCEEEEEECCCCCEEEEEeC
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG----VLPAANVP--PP--YALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~----vl~gh~~p--~~--GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
                      .++.+++++||..+..++|-|++|-=|++.+|+-.+-..    ++..|.+|  ++  +|...|.+++.||||++||+|+.
T Consensus       143 ~s~~~vals~d~~~~fsask~g~i~kw~v~tgk~~~~i~~~~ev~k~~~~~~k~~r~~h~keil~~avS~Dgkylatgg~  222 (479)
T KOG0299|consen  143 LSVTSVALSPDDKRVFSASKDGTILKWDVLTGKKDRYIIERDEVLKSHGNPLKESRKGHVKEILTLAVSSDGKYLATGGR  222 (479)
T ss_pred             CcceEEEeeccccceeecCCCcceeeeehhcCcccccccccchhhhhccCCCCcccccccceeEEEEEcCCCcEEEecCC
Confidence            456899999999999999999999999999998542111    11224443  23  78899999999999999999999


Q ss_pred             CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL 2371 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s 2371 (2389)
                      |..|.|||..+.     .++..+.+|.+.|.+++|--+..+++ ++   |.|++|++|++  .+-..+.+|.||++.|..
T Consensus       223 d~~v~Iw~~~t~-----ehv~~~~ghr~~V~~L~fr~gt~~ly-s~---s~Drsvkvw~~--~~~s~vetlyGHqd~v~~  291 (479)
T KOG0299|consen  223 DRHVQIWDCDTL-----EHVKVFKGHRGAVSSLAFRKGTSELY-SA---SADRSVKVWSI--DQLSYVETLYGHQDGVLG  291 (479)
T ss_pred             CceEEEecCccc-----chhhcccccccceeeeeeecCcccee-ee---ecCCceEEEeh--hHhHHHHHHhCCccceee
Confidence            999999999986     46777899999999999997554555 44   58999999998  344458899999999998


Q ss_pred             Eee
Q 000080         2372 FLP 2374 (2389)
Q Consensus      2372 vA~ 2374 (2389)
                      |.-
T Consensus       292 Ida  294 (479)
T KOG0299|consen  292 IDA  294 (479)
T ss_pred             ech
Confidence            874


No 106
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.19  E-value=2.9e-10  Score=133.49  Aligned_cols=151  Identities=15%  Similarity=0.085  Sum_probs=115.0

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC--------C-------------------------
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV--------P------------------------- 2266 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~--------p------------------------- 2266 (2389)
                      .+|.+|.||++|..++++++|-+++|+|..+|+++++... +-+.+        +                         
T Consensus        15 ~~i~sl~fs~~G~~litss~dDsl~LYd~~~g~~~~ti~s-kkyG~~~~~Fth~~~~~i~sStk~d~tIryLsl~dNkyl   93 (311)
T KOG1446|consen   15 GKINSLDFSDDGLLLITSSEDDSLRLYDSLSGKQVKTINS-KKYGVDLACFTHHSNTVIHSSTKEDDTIRYLSLHDNKYL   93 (311)
T ss_pred             CceeEEEecCCCCEEEEecCCCeEEEEEcCCCceeeEeec-ccccccEEEEecCCceEEEccCCCCCceEEEEeecCceE
Confidence            4568999999999999999999999999999998876531 10000        0                         


Q ss_pred             --CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080         2267 --PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus      2267 --~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
                        .+||...|.++.-+|-+..|.|+|.|+||||||+++..     +.--+  +...-.-+||.| .|-++|.|   ....
T Consensus        94 RYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~-----cqg~l--~~~~~pi~AfDp-~GLifA~~---~~~~  162 (311)
T KOG1446|consen   94 RYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKK-----CQGLL--NLSGRPIAAFDP-EGLIFALA---NGSE  162 (311)
T ss_pred             EEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCC-----CceEE--ecCCCcceeECC-CCcEEEEe---cCCC
Confidence              78999999999999999999999999999999999752     21111  222333589999 99999885   3444


Q ss_pred             eEEEeeCCCCCCCceEEEE---eecCcEEEEeecccchhhh
Q 000080         2345 NVVVWDTLAPPTSSRASIT---CHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2345 TVrLWD~l~~tg~~v~sL~---GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      .|+|+|+..-.....+++.   +-..+.+.+-+|++|..+|
T Consensus       163 ~IkLyD~Rs~dkgPF~tf~i~~~~~~ew~~l~FS~dGK~iL  203 (311)
T KOG1446|consen  163 LIKLYDLRSFDKGPFTTFSITDNDEAEWTDLEFSPDGKSIL  203 (311)
T ss_pred             eEEEEEecccCCCCceeEccCCCCccceeeeEEcCCCCEEE
Confidence            9999998543334444443   3466788999999998876


No 107
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.18  E-value=4.4e-11  Score=138.99  Aligned_cols=175  Identities=15%  Similarity=0.196  Sum_probs=136.7

Q ss_pred             cccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCC
Q 000080         2190 GYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPY 2269 (2389)
Q Consensus      2190 g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~G 2269 (2389)
                      |++....+.|-..+ ..+.-......+-++|  +.|+-....+++.++|.|.|.+||.+++|+|+.+|+          |
T Consensus       122 a~tsrivssFk~~t-~~~~lvre~~GHkDGi--W~Vaa~~tqpi~gtASADhTA~iWs~Esg~CL~~Y~----------G  188 (481)
T KOG0300|consen  122 APTSRIVSSFKDGT-VKFRLVRELEGHKDGI--WHVAADSTQPICGTASADHTARIWSLESGACLATYT----------G  188 (481)
T ss_pred             CCcchheeeecCCc-eeEeehhhhcccccce--eeehhhcCCcceeecccccceeEEeeccccceeeec----------c
Confidence            44455555544222 2222222334445544  999999999999999999999999999999999994          6


Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC----CCC---------------------------cc----Ccccceee
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQLE----VGG---------------------------RS----NVRPMESC 2314 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~----tgg---------------------------rs----~~k~l~tl 2314 (2389)
                      |.+.|.+|+|+|.|..+++||+|+|-.||...    +..                           ++    .-.|+..+
T Consensus       189 H~GSVNsikfh~s~~L~lTaSGD~taHIW~~av~~~vP~~~a~~~hSsEeE~e~sDe~~~d~d~~~~sD~~tiRvPl~~l  268 (481)
T KOG0300|consen  189 HTGSVNSIKFHNSGLLLLTASGDETAHIWKAAVNWEVPSNNAPSDHSSEEEEEHSDEHNRDTDSSEKSDGHTIRVPLMRL  268 (481)
T ss_pred             cccceeeEEeccccceEEEccCCcchHHHHHhhcCcCCCCCCCCCCCchhhhhcccccccccccccccCCceeeeeeeee
Confidence            88999999999999999999999999999721    100                           00    11367789


Q ss_pred             eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      .||.+.|.+..|.. .|+.++||   |.|+|.-|||+  .++..++.|.||+...+-++-+|--+-.|.
T Consensus       269 tgH~~vV~a~dWL~-gg~Q~vTa---SWDRTAnlwDV--Etge~v~~LtGHd~ELtHcstHptQrLVvT  331 (481)
T KOG0300|consen  269 TGHRAVVSACDWLA-GGQQMVTA---SWDRTANLWDV--ETGEVVNILTGHDSELTHCSTHPTQRLVVT  331 (481)
T ss_pred             eccccceEehhhhc-Ccceeeee---eccccceeeee--ccCceeccccCcchhccccccCCcceEEEE
Confidence            99999999999998 89999997   69999999998  688889999999999887777776655544


No 108
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.18  E-value=2.8e-11  Score=144.94  Aligned_cols=171  Identities=16%  Similarity=0.127  Sum_probs=136.8

Q ss_pred             ccc-ccceeeccccccccccccccC----CCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCC
Q 000080         2190 GYA-GIGASALGWETQDDFEDYVDP----PATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPA 2262 (2389)
Q Consensus      2190 g~~-~~~Asg~~~d~~~~~~~~~d~----~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~g 2262 (2389)
                      ++. +.+|+| |-|..+.+|...-.    ..++.+  ..|.++.|.++++.++++|.|+++++|++.+++...||.    
T Consensus       184 l~~sdtlatg-g~Dr~Ik~W~v~~~k~~~~~tLaGs~g~it~~d~d~~~~~~iAas~d~~~r~Wnvd~~r~~~TLs----  258 (459)
T KOG0288|consen  184 LRNSDTLATG-GSDRIIKLWNVLGEKSELISTLAGSLGNITSIDFDSDNKHVIAASNDKNLRLWNVDSLRLRHTLS----  258 (459)
T ss_pred             ccCcchhhhc-chhhhhhhhhcccchhhhhhhhhccCCCcceeeecCCCceEEeecCCCceeeeeccchhhhhhhc----
Confidence            444 677888 88888999987532    233332  357999999999999999999999999999999999984    


Q ss_pred             CCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080         2263 ANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus      2263 h~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
                            ||++.|+++.|.-.-...++|+.|.|||+||+..+     .+..+.. ....+++|+-++   ..++| |  -.
T Consensus       259 ------GHtdkVt~ak~~~~~~~vVsgs~DRtiK~WDl~k~-----~C~kt~l-~~S~cnDI~~~~---~~~~S-g--H~  320 (459)
T KOG0288|consen  259 ------GHTDKVTAAKFKLSHSRVVSGSADRTIKLWDLQKA-----YCSKTVL-PGSQCNDIVCSI---SDVIS-G--HF  320 (459)
T ss_pred             ------ccccceeeehhhccccceeeccccchhhhhhhhhh-----heecccc-ccccccceEecc---eeeee-c--cc
Confidence                  68899999999998888999999999999999875     2333332 235678888875   45666 4  48


Q ss_pred             CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcccc
Q 000080         2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus      2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
                      |++||.||.  ....++.+...|. .|++|..+.+|+-.||--|
T Consensus       321 DkkvRfwD~--Rs~~~~~sv~~gg-~vtSl~ls~~g~~lLsssR  361 (459)
T KOG0288|consen  321 DKKVRFWDI--RSADKTRSVPLGG-RVTSLDLSMDGLELLSSSR  361 (459)
T ss_pred             ccceEEEec--cCCceeeEeecCc-ceeeEeeccCCeEEeeecC
Confidence            999999997  4567788888776 9999999999999888543


No 109
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.17  E-value=1.8e-10  Score=132.67  Aligned_cols=152  Identities=16%  Similarity=0.173  Sum_probs=122.7

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc---------cCCCC---------CC---------------
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV---------LPAAN---------VP--------------- 2266 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v---------l~gh~---------~p--------------- 2266 (2389)
                      ..|++++..-+.+.++|||.|.++||||+.+|+++.++..         ..+.+         |.               
T Consensus        53 GavW~~Did~~s~~liTGSAD~t~kLWDv~tGk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~  132 (327)
T KOG0643|consen   53 GAVWCCDIDWDSKHLITGSADQTAKLWDVETGKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSS  132 (327)
T ss_pred             ceEEEEEecCCcceeeeccccceeEEEEcCCCcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChh
Confidence            3569999999999999999999999999999999877641         00111         00               


Q ss_pred             ----------CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEE
Q 000080         2267 ----------PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus      2267 ----------~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
                                .+-+.+.++..-++|-|++|.+|..||.|..||+++|.    +.+.+-+-|+..|+++.|+| |.++.+|
T Consensus       133 ~~~s~ep~~kI~t~~skit~a~Wg~l~~~ii~Ghe~G~is~~da~~g~----~~v~s~~~h~~~Ind~q~s~-d~T~FiT  207 (327)
T KOG0643|consen  133 DIDSEEPYLKIPTPDSKITSALWGPLGETIIAGHEDGSISIYDARTGK----ELVDSDEEHSSKINDLQFSR-DRTYFIT  207 (327)
T ss_pred             hhcccCceEEecCCccceeeeeecccCCEEEEecCCCcEEEEEcccCc----eeeechhhhccccccccccC-CcceEEe
Confidence                      12234678888899999999999999999999999873    45666678999999999999 9999999


Q ss_pred             eecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2337 AGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2337 AG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      +   |.|.|-+|||+.  +-++++++. -+-+|++.|.+|..++.+
T Consensus       208 ~---s~Dttakl~D~~--tl~v~Kty~-te~PvN~aaisP~~d~Vi  247 (327)
T KOG0643|consen  208 G---SKDTTAKLVDVR--TLEVLKTYT-TERPVNTAAISPLLDHVI  247 (327)
T ss_pred             c---ccCccceeeecc--ceeeEEEee-ecccccceecccccceEE
Confidence            6   799999999983  445567776 456899999999887653


No 110
>KOG0299 consensus U3 snoRNP-associated protein (contains WD40 repeats) [RNA processing and modification]
Probab=99.17  E-value=9.3e-11  Score=142.02  Aligned_cols=136  Identities=15%  Similarity=0.256  Sum_probs=117.2

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      -.|-+++.+|||++||+|+.|..|.|||..+.+.++++.          ||.+.|.+++|--.-+.|-|+|.|++|++|+
T Consensus       203 keil~~avS~Dgkylatgg~d~~v~Iw~~~t~ehv~~~~----------ghr~~V~~L~fr~gt~~lys~s~Drsvkvw~  272 (479)
T KOG0299|consen  203 KEILTLAVSSDGKYLATGGRDRHVQIWDCDTLEHVKVFK----------GHRGAVSSLAFRKGTSELYSASADRSVKVWS  272 (479)
T ss_pred             ceeEEEEEcCCCcEEEecCCCceEEEecCcccchhhccc----------ccccceeeeeeecCccceeeeecCCceEEEe
Confidence            355899999999999999999999999999999998873          5789999999998889999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      ++.-     ..+.++-||++.|.++.-..  -...||+|  ..|+|+|||++   +....-.+.+|.+.+-|+|+=-+
T Consensus       273 ~~~~-----s~vetlyGHqd~v~~IdaL~--reR~vtVG--grDrT~rlwKi---~eesqlifrg~~~sidcv~~In~  338 (479)
T KOG0299|consen  273 IDQL-----SYVETLYGHQDGVLGIDALS--RERCVTVG--GRDRTVRLWKI---PEESQLIFRGGEGSIDCVAFIND  338 (479)
T ss_pred             hhHh-----HHHHHHhCCccceeeechhc--ccceEEec--cccceeEEEec---cccceeeeeCCCCCeeeEEEecc
Confidence            9864     35788899999999988775  46788886  69999999998   34456678899988998887433


No 111
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.17  E-value=4.9e-11  Score=140.00  Aligned_cols=144  Identities=19%  Similarity=0.239  Sum_probs=116.7

Q ss_pred             EEEEEcCC----CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEE
Q 000080         2223 RAFSSHPL----RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCT 2297 (2389)
Q Consensus      2223 rsVAFsPd----G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkL 2297 (2389)
                      ..++|+-|    .+++|.|+.=|.||+-|+.++++...|+          ||.+.|..|.|.|+. +++.|||.|.+|||
T Consensus        93 ytcsw~yd~~~~~p~la~~G~~GvIrVid~~~~~~~~~~~----------ghG~sINeik~~p~~~qlvls~SkD~svRl  162 (385)
T KOG1034|consen   93 YTCSWSYDSNTGNPFLAAGGYLGVIRVIDVVSGQCSKNYR----------GHGGSINEIKFHPDRPQLVLSASKDHSVRL  162 (385)
T ss_pred             EEEEEEecCCCCCeeEEeecceeEEEEEecchhhhcccee----------ccCccchhhhcCCCCCcEEEEecCCceEEE
Confidence            44566554    5689999999999999999999988875          466889999999997 89999999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC----------------------CC
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA----------------------PP 2355 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~----------------------~t 2355 (2389)
                      ||+++..  ++-.+....||.+.|.+|.|++ +|.+|||+|   .|.++++|++..                      ++
T Consensus       163 wnI~~~~--Cv~VfGG~egHrdeVLSvD~~~-~gd~i~ScG---mDhslk~W~l~~~~f~~~lE~s~~~~~~~t~~pfpt  236 (385)
T KOG1034|consen  163 WNIQTDV--CVAVFGGVEGHRDEVLSVDFSL-DGDRIASCG---MDHSLKLWRLNVKEFKNKLELSITYSPNKTTRPFPT  236 (385)
T ss_pred             EeccCCe--EEEEecccccccCcEEEEEEcC-CCCeeeccC---CcceEEEEecChhHHhhhhhhhcccCCCCccCcCCc
Confidence            9999873  4455677899999999999999 999999976   899999999831                      11


Q ss_pred             CCc-e---EEEEeecCcEEEEeecccchhhhcc
Q 000080         2356 TSS-R---ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2356 g~~-v---~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      .++ +   .+-.-|++-|.|+-..  |||+|||
T Consensus       237 ~~~~fp~fst~diHrnyVDCvrw~--gd~ilSk  267 (385)
T KOG1034|consen  237 PKTHFPDFSTTDIHRNYVDCVRWF--GDFILSK  267 (385)
T ss_pred             cccccccccccccccchHHHHHHH--hhheeec
Confidence            111 1   1334588888887764  6999998


No 112
>KOG0283 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.16  E-value=1.7e-10  Score=147.15  Aligned_cols=108  Identities=19%  Similarity=0.274  Sum_probs=91.8

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl 2300 (2389)
                      |-.|+||-++ +|+|+|-|.|||||+++..+|+.+|.           |.+.|+||+|+|- .++|+|||.||.||||++
T Consensus       372 ILDlSWSKn~-fLLSSSMDKTVRLWh~~~~~CL~~F~-----------HndfVTcVaFnPvDDryFiSGSLD~KvRiWsI  439 (712)
T KOG0283|consen  372 ILDLSWSKNN-FLLSSSMDKTVRLWHPGRKECLKVFS-----------HNDFVTCVAFNPVDDRYFISGSLDGKVRLWSI  439 (712)
T ss_pred             heecccccCC-eeEeccccccEEeecCCCcceeeEEe-----------cCCeeEEEEecccCCCcEeecccccceEEeec
Confidence            3778999865 88899999999999999999999995           6799999999996 589999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      -..     +...-..+| .-|++|+|.| ||+..+.|   +-+|.++++++
T Consensus       440 ~d~-----~Vv~W~Dl~-~lITAvcy~P-dGk~avIG---t~~G~C~fY~t  480 (712)
T KOG0283|consen  440 SDK-----KVVDWNDLR-DLITAVCYSP-DGKGAVIG---TFNGYCRFYDT  480 (712)
T ss_pred             CcC-----eeEeehhhh-hhheeEEecc-CCceEEEE---EeccEEEEEEc
Confidence            753     222222333 7899999999 89988875   68999999998


No 113
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=99.15  E-value=1.7e-10  Score=146.47  Aligned_cols=176  Identities=13%  Similarity=0.179  Sum_probs=143.3

Q ss_pred             ccccccccccccceeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCC
Q 000080         2183 GLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPA 2262 (2389)
Q Consensus      2183 ~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~g 2262 (2389)
                      -|-|++-||..=-...||-.--.-...|-+.+++-  -+|+.|+..-.++.++|++.||.++.||+.++..+.+++.  +
T Consensus       459 CGNF~~IG~S~G~Id~fNmQSGi~r~sf~~~~ah~--~~V~gla~D~~n~~~vsa~~~Gilkfw~f~~k~l~~~l~l--~  534 (910)
T KOG1539|consen  459 CGNFVFIGYSKGTIDRFNMQSGIHRKSFGDSPAHK--GEVTGLAVDGTNRLLVSAGADGILKFWDFKKKVLKKSLRL--G  534 (910)
T ss_pred             cCceEEEeccCCeEEEEEcccCeeecccccCcccc--CceeEEEecCCCceEEEccCcceEEEEecCCcceeeeecc--C
Confidence            34677777776666665555555555554444443  3459999999999999999999999999988888888763  2


Q ss_pred             CCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080         2263 ANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus      2263 h~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
                               ..+..+..+.....||.+.+|=.|++.|+.|.     +..+.+.||++.|++.+||| ||++|++|   +.
T Consensus       535 ---------~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~-----kvvR~f~gh~nritd~~FS~-DgrWlisa---sm  596 (910)
T KOG1539|consen  535 ---------SSITGIVYHRVSDLLAIALDDFSIRVVDVVTR-----KVVREFWGHGNRITDMTFSP-DGRWLISA---SM  596 (910)
T ss_pred             ---------CCcceeeeeehhhhhhhhcCceeEEEEEchhh-----hhhHHhhccccceeeeEeCC-CCcEEEEe---ec
Confidence                     45788888888899999999999999999984     57788999999999999999 99999998   69


Q ss_pred             CCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2343 GINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2343 D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      |++||+||+  ++++++-.+- -+....++.++|-|+|...
T Consensus       597 D~tIr~wDl--pt~~lID~~~-vd~~~~sls~SPngD~LAT  634 (910)
T KOG1539|consen  597 DSTIRTWDL--PTGTLIDGLL-VDSPCTSLSFSPNGDFLAT  634 (910)
T ss_pred             CCcEEEEec--cCcceeeeEe-cCCcceeeEECCCCCEEEE
Confidence            999999998  7888776664 5678899999999998643


No 114
>KOG0300 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.14  E-value=2.9e-10  Score=132.40  Aligned_cols=156  Identities=21%  Similarity=0.301  Sum_probs=116.3

Q ss_pred             cccccccccccc--cCCCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2200 GWETQDDFEDYV--DPPATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2200 ~~d~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      +||-+.-+|+..  .++..+.+  -...-++-||+.++++++|.|.|.||||++  ..++...++       .||.+.|+
T Consensus       291 SWDRTAnlwDVEtge~v~~LtGHd~ELtHcstHptQrLVvTsSrDtTFRLWDFR--eaI~sV~VF-------QGHtdtVT  361 (481)
T KOG0300|consen  291 SWDRTANLWDVETGEVVNILTGHDSELTHCSTHPTQRLVVTSSRDTTFRLWDFR--EAIQSVAVF-------QGHTDTVT  361 (481)
T ss_pred             eccccceeeeeccCceeccccCcchhccccccCCcceEEEEeccCceeEeccch--hhcceeeee-------ccccccee
Confidence            677777777653  11111111  123445889999999999999999999997  444443333       26789999


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      ++.|+-|. .++|||+|.|||+||++.. |   .|+.+.. -...++.|+.+. .+.+||--   -+++.|||+|+   +
T Consensus       362 S~vF~~dd-~vVSgSDDrTvKvWdLrNM-R---splATIR-tdS~~NRvavs~-g~~iIAiP---hDNRqvRlfDl---n  428 (481)
T KOG0300|consen  362 SVVFNTDD-RVVSGSDDRTVKVWDLRNM-R---SPLATIR-TDSPANRVAVSK-GHPIIAIP---HDNRQVRLFDL---N  428 (481)
T ss_pred             EEEEecCC-ceeecCCCceEEEeeeccc-c---Ccceeee-cCCccceeEeec-CCceEEec---cCCceEEEEec---C
Confidence            99999875 6899999999999999986 3   4666665 456789999998 66788874   47899999998   3


Q ss_pred             CCceE-----EEEeecCcEEEEeeccc
Q 000080         2356 TSSRA-----SITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2356 g~~v~-----sL~GH~~~V~svA~~~~ 2377 (2389)
                      |..+.     +-+||.--|+|.|-.+.
T Consensus       429 G~RlaRlPrtsRqgHrRMV~c~AW~ee  455 (481)
T KOG0300|consen  429 GNRLARLPRTSRQGHRRMVTCCAWLEE  455 (481)
T ss_pred             CCccccCCcccccccceeeeeeecccc
Confidence            54443     45799999999997764


No 115
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.12  E-value=7e-11  Score=143.14  Aligned_cols=143  Identities=13%  Similarity=0.147  Sum_probs=116.1

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .+||++-.+|||+.|++|+.-.|+.|||+.........+ ++..       ....++++.|||.+...++..||.|.+||
T Consensus       466 nyiRSckL~pdgrtLivGGeastlsiWDLAapTprikae-ltss-------apaCyALa~spDakvcFsccsdGnI~vwD  537 (705)
T KOG0639|consen  466 NYIRSCKLLPDGRTLIVGGEASTLSIWDLAAPTPRIKAE-LTSS-------APACYALAISPDAKVCFSCCSDGNIAVWD  537 (705)
T ss_pred             cceeeeEecCCCceEEeccccceeeeeeccCCCcchhhh-cCCc-------chhhhhhhcCCccceeeeeccCCcEEEEE
Confidence            478999999999999999999999999998776433222 1111       13478899999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      +...     ..+++++||++.+.+|..++ ||..|=|||   -|+|||-||..  ++..++.-+ ...+|-++...|.|+
T Consensus       538 Lhnq-----~~VrqfqGhtDGascIdis~-dGtklWTGG---lDntvRcWDlr--egrqlqqhd-F~SQIfSLg~cP~~d  605 (705)
T KOG0639|consen  538 LHNQ-----TLVRQFQGHTDGASCIDISK-DGTKLWTGG---LDNTVRCWDLR--EGRQLQQHD-FSSQIFSLGYCPTGD  605 (705)
T ss_pred             cccc-----eeeecccCCCCCceeEEecC-CCceeecCC---Cccceeehhhh--hhhhhhhhh-hhhhheecccCCCcc
Confidence            9864     46899999999999999999 999999976   89999999983  333333222 346788999999999


Q ss_pred             hhh
Q 000080         2380 FAL 2382 (2389)
Q Consensus      2380 ~~~ 2382 (2389)
                      |.+
T Consensus       606 Wla  608 (705)
T KOG0639|consen  606 WLA  608 (705)
T ss_pred             cee
Confidence            964


No 116
>PF08662 eIF2A:  Eukaryotic translation initiation factor eIF2A;  InterPro: IPR013979  This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins. 
Probab=99.12  E-value=7.6e-10  Score=124.65  Aligned_cols=116  Identities=17%  Similarity=0.280  Sum_probs=90.9

Q ss_pred             eEEEEEEcCCCCeEE--EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcE
Q 000080         2221 STRAFSSHPLRPFFL--VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTV 2295 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LA--SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTV 2295 (2389)
                      +|.+++|+|+|..+|  +|..++.|.|||+. ++.+.++.            ...+..|.|||+|++||.|+.+   |.|
T Consensus        61 ~I~~~~WsP~g~~favi~g~~~~~v~lyd~~-~~~i~~~~------------~~~~n~i~wsP~G~~l~~~g~~n~~G~l  127 (194)
T PF08662_consen   61 PIHDVAWSPNGNEFAVIYGSMPAKVTLYDVK-GKKIFSFG------------TQPRNTISWSPDGRFLVLAGFGNLNGDL  127 (194)
T ss_pred             ceEEEEECcCCCEEEEEEccCCcccEEEcCc-ccEeEeec------------CCCceEEEECCCCCEEEEEEccCCCcEE
Confidence            579999999999754  46678899999995 77777762            2457899999999999999855   669


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC----CCCeEEEeeCCCCCCCceEE
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS----NGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS----~D~TVrLWD~l~~tg~~v~s 2361 (2389)
                      .+||+++.     +.+.+.. |. .+..++|+| ||++|||+. ++    .|+.++||+.   +|+.+..
T Consensus       128 ~~wd~~~~-----~~i~~~~-~~-~~t~~~WsP-dGr~~~ta~-t~~r~~~dng~~Iw~~---~G~~l~~  185 (194)
T PF08662_consen  128 EFWDVRKK-----KKISTFE-HS-DATDVEWSP-DGRYLATAT-TSPRLRVDNGFKIWSF---QGRLLYK  185 (194)
T ss_pred             EEEECCCC-----EEeeccc-cC-cEEEEEEcC-CCCEEEEEE-eccceeccccEEEEEe---cCeEeEe
Confidence            99999964     3444442 43 478999999 999999985 22    5899999997   5666544


No 117
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.12  E-value=1.3e-09  Score=123.57  Aligned_cols=139  Identities=9%  Similarity=0.002  Sum_probs=100.1

Q ss_pred             EEEEEcCCCCeEE-EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCcEEEeeC
Q 000080         2223 RAFSSHPLRPFFL-VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGTVCTWQL 2300 (2389)
Q Consensus      2223 rsVAFsPdG~~LA-SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgTVkLWDl 2300 (2389)
                      +.++|+|+|++|+ ++..|++|++||+.+++++.++.. .....+ ++ ......++|+|||+.+. +.+.+++|.+||+
T Consensus       160 ~~~~~s~dg~~l~~~~~~~~~v~i~d~~~~~~~~~~~~-~~~~~~-~~-~~~~~~i~~s~dg~~~~~~~~~~~~i~v~d~  236 (300)
T TIGR03866       160 RFAEFTADGKELWVSSEIGGTVSVIDVATRKVIKKITF-EIPGVH-PE-AVQPVGIKLTKDGKTAFVALGPANRVAVVDA  236 (300)
T ss_pred             cEEEECCCCCEEEEEcCCCCEEEEEEcCcceeeeeeee-cccccc-cc-cCCccceEECCCCCEEEEEcCCCCeEEEEEC
Confidence            6689999999875 555699999999999988776531 111100 01 12345789999999854 4456788999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      +++.     ..... .+...+.+++|+| +|+.|++++  ..+++|++||+  .+++++++++.+ ++.+.+|++|
T Consensus       237 ~~~~-----~~~~~-~~~~~~~~~~~~~-~g~~l~~~~--~~~~~i~v~d~--~~~~~~~~~~~~-~~~~~~~~~~  300 (300)
T TIGR03866       237 KTYE-----VLDYL-LVGQRVWQLAFTP-DEKYLLTTN--GVSNDVSVIDV--AALKVIKSIKVG-RLPWGVVVRP  300 (300)
T ss_pred             CCCc-----EEEEE-EeCCCcceEEECC-CCCEEEEEc--CCCCeEEEEEC--CCCcEEEEEEcc-cccceeEeCC
Confidence            8762     23332 2445788999999 999998753  47899999998  467778888754 5668888764


No 118
>KOG0269 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.11  E-value=8.2e-11  Score=148.40  Aligned_cols=144  Identities=19%  Similarity=0.253  Sum_probs=120.7

Q ss_pred             EEEEEEcC-CCCeEEEEeCCCcEEEeecCC---CceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080         2222 TRAFSSHP-LRPFFLVGSSNTHIYLWEFGK---DKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus      2222 VrsVAFsP-dG~~LASGS~DgTIRLWDl~t---Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
                      .-.|.|+. +.++|||++..|.|-+||+..   .+++..|.          -|...|+++.|++-- +.|.|||.||+||
T Consensus        90 ~~DVkW~~~~~NlIAT~s~nG~i~vWdlnk~~rnk~l~~f~----------EH~Rs~~~ldfh~tep~iliSGSQDg~vK  159 (839)
T KOG0269|consen   90 AADVKWGQLYSNLIATCSTNGVISVWDLNKSIRNKLLTVFN----------EHERSANKLDFHSTEPNILISGSQDGTVK  159 (839)
T ss_pred             hhhcccccchhhhheeecCCCcEEEEecCccccchhhhHhh----------hhccceeeeeeccCCccEEEecCCCceEE
Confidence            34456774 366899999999999999986   44555553          367899999999874 8999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      +||++..     +-..+..+-+-.|++|.|+|..+...|++   .+.|++++||+. ++.+|...|..|.+.|.|+..+|
T Consensus       160 ~~DlR~~-----~S~~t~~~nSESiRDV~fsp~~~~~F~s~---~dsG~lqlWDlR-qp~r~~~k~~AH~GpV~c~nwhP  230 (839)
T KOG0269|consen  160 CWDLRSK-----KSKSTFRSNSESIRDVKFSPGYGNKFASI---HDSGYLQLWDLR-QPDRCEKKLTAHNGPVLCLNWHP  230 (839)
T ss_pred             EEeeecc-----cccccccccchhhhceeeccCCCceEEEe---cCCceEEEeecc-CchhHHHHhhcccCceEEEeecC
Confidence            9999975     23455666788999999999999999986   589999999996 57888999999999999999999


Q ss_pred             cchhhhcc
Q 000080         2377 LLNFALSK 2384 (2389)
Q Consensus      2377 ~~~~~~s~ 2384 (2389)
                      .+.|+-+-
T Consensus       231 nr~~lATG  238 (839)
T KOG0269|consen  231 NREWLATG  238 (839)
T ss_pred             CCceeeec
Confidence            99987654


No 119
>KOG0643 consensus Translation initiation factor 3, subunit i (eIF-3i)/TGF-beta receptor-interacting protein (TRIP-1) [Translation, ribosomal structure and biogenesis; Signal transduction mechanisms]
Probab=99.11  E-value=5.5e-10  Score=128.80  Aligned_cols=148  Identities=11%  Similarity=0.137  Sum_probs=129.0

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .-|.++.+|.+|.|++-|.++.+|=--+|+.+-||.          ||++.|+++..+-+.+.+.+||.|.|++|||+++
T Consensus        14 TqiKyN~eGDLlFscaKD~~~~vw~s~nGerlGty~----------GHtGavW~~Did~~s~~liTGSAD~t~kLWDv~t   83 (327)
T KOG0643|consen   14 TQIKYNREGDLLFSCAKDSTPTVWYSLNGERLGTYD----------GHTGAVWCCDIDWDSKHLITGSADQTAKLWDVET   83 (327)
T ss_pred             ceEEecCCCcEEEEecCCCCceEEEecCCceeeeec----------CCCceEEEEEecCCcceeeeccccceeEEEEcCC
Confidence            556999999999999999999999988999999995          6789999999999999999999999999999999


Q ss_pred             CCc------------------------------------------------cCcccceeeeecCCCeeEEEEecCCCCEE
Q 000080         2303 GGR------------------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVI 2334 (2389)
Q Consensus      2303 ggr------------------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslL 2334 (2389)
                      |..                                                ....|+..+..+...+..+-|.| -|+.|
T Consensus        84 Gk~la~~k~~~~Vk~~~F~~~gn~~l~~tD~~mg~~~~v~~fdi~~~~~~~~s~ep~~kI~t~~skit~a~Wg~-l~~~i  162 (327)
T KOG0643|consen   84 GKQLATWKTNSPVKRVDFSFGGNLILASTDKQMGYTCFVSVFDIRDDSSDIDSEEPYLKIPTPDSKITSALWGP-LGETI  162 (327)
T ss_pred             CcEEEEeecCCeeEEEeeccCCcEEEEEehhhcCcceEEEEEEccCChhhhcccCceEEecCCccceeeeeecc-cCCEE
Confidence            832                                                02345777788889999999999 89999


Q ss_pred             EEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecccchhhhcccc
Q 000080         2335 AAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus      2335 ASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~~~~~~~s~~~ 2386 (2389)
                      .++   -+|+.|.+||.  .+++. +.+-+-|...|+.+-+++++-+-+..|+
T Consensus       163 i~G---he~G~is~~da--~~g~~~v~s~~~h~~~Ind~q~s~d~T~FiT~s~  210 (327)
T KOG0643|consen  163 IAG---HEDGSISIYDA--RTGKELVDSDEEHSSKINDLQFSRDRTYFITGSK  210 (327)
T ss_pred             EEe---cCCCcEEEEEc--ccCceeeechhhhccccccccccCCcceEEeccc
Confidence            986   48999999998  45544 7888999999999999999988776654


No 120
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=99.11  E-value=9.7e-10  Score=123.91  Aligned_cols=144  Identities=16%  Similarity=0.215  Sum_probs=109.8

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC---C-------CCCCCCCEEEEEECCCCCEEEEE
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV---P-------PPYALASISALQFDHYGHRFASA 2289 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~---p-------~~GH~~~V~sVaFSPDG~~LASg 2289 (2389)
                      -.||+|+|||.|.+.|.||...|.|+-....=.   .++  .+|..   |       .-.|.+.|+++++||+|..||+|
T Consensus        33 qairav~fhp~g~lyavgsnskt~ric~yp~l~---~~r--~~hea~~~pp~v~~kr~khhkgsiyc~~ws~~geliatg  107 (350)
T KOG0641|consen   33 QAIRAVAFHPAGGLYAVGSNSKTFRICAYPALI---DLR--HAHEAAKQPPSVLCKRNKHHKGSIYCTAWSPCGELIATG  107 (350)
T ss_pred             hheeeEEecCCCceEEeccCCceEEEEcccccc---Ccc--cccccccCCCeEEeeeccccCccEEEEEecCccCeEEec
Confidence            457999999999999999999999998753111   111  11211   1       12477899999999999999999


Q ss_pred             eCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC---CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec
Q 000080         2290 ALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS---SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus      2290 S~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~---DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
                      |.|.+||+--.+.......-+-..+.-|.+.|++++|.-+   .|.+|||||  ..|..|.+=|.  ..|+..+.+.||+
T Consensus       108 sndk~ik~l~fn~dt~~~~g~dle~nmhdgtirdl~fld~~~s~~~il~s~g--agdc~iy~tdc--~~g~~~~a~sght  183 (350)
T KOG0641|consen  108 SNDKTIKVLPFNADTCNATGHDLEFNMHDGTIRDLAFLDDPESGGAILASAG--AGDCKIYITDC--GRGQGFHALSGHT  183 (350)
T ss_pred             CCCceEEEEecccccccccCcceeeeecCCceeeeEEecCCCcCceEEEecC--CCcceEEEeec--CCCCcceeecCCc
Confidence            9999999987765322112233556679999999999843   567899987  67888888887  6788899999999


Q ss_pred             CcEEEE
Q 000080         2367 GLYDLF 2372 (2389)
Q Consensus      2367 ~~V~sv 2372 (2389)
                      +-|-++
T Consensus       184 ghilal  189 (350)
T KOG0641|consen  184 GHILAL  189 (350)
T ss_pred             ccEEEE
Confidence            988654


No 121
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=99.11  E-value=1.8e-09  Score=121.14  Aligned_cols=142  Identities=23%  Similarity=0.310  Sum_probs=114.3

Q ss_pred             eEEEEEEcCCCCeEEEEeC-CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC-EEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRPFFLVGSS-NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH-RFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~-DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLW 2298 (2389)
                      .|+.++|+|+++.+++++. |+++++|+..+++.+.++.          +|...|.+++|+|+|. .+++++.|++|++|
T Consensus       157 ~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~----------~~~~~v~~~~~~~~~~~~~~~~~~d~~i~~w  226 (466)
T COG2319         157 SVTSLAFSPDGKLLASGSSLDGTIKLWDLRTGKPLSTLA----------GHTDPVSSLAFSPDGGLLIASGSSDGTIRLW  226 (466)
T ss_pred             cEEEEEECCCCCEEEecCCCCCceEEEEcCCCceEEeec----------cCCCceEEEEEcCCcceEEEEecCCCcEEEE
Confidence            3478999999999999986 9999999998888877763          3678999999999998 66777999999999


Q ss_pred             eCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2299 QLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      |...+     .... .+.+|...+ -..|+| +|..++++   +.|+++++||+.. ....+..+.+|...|.++++.|+
T Consensus       227 d~~~~-----~~~~~~~~~~~~~~-~~~~~~-~~~~~~~~---~~d~~~~~~~~~~-~~~~~~~~~~~~~~v~~~~~~~~  295 (466)
T COG2319         227 DLSTG-----KLLRSTLSGHSDSV-VSSFSP-DGSLLASG---SSDGTIRLWDLRS-SSSLLRTLSGHSSSVLSVAFSPD  295 (466)
T ss_pred             ECCCC-----cEEeeecCCCCcce-eEeECC-CCCEEEEe---cCCCcEEEeeecC-CCcEEEEEecCCccEEEEEECCC
Confidence            98864     2344 588888875 448999 77888865   6999999999842 22235555889999999999997


Q ss_pred             chhhhc
Q 000080         2378 LNFALS 2383 (2389)
Q Consensus      2378 ~~~~~s 2383 (2389)
                      ++...+
T Consensus       296 ~~~~~~  301 (466)
T COG2319         296 GKLLAS  301 (466)
T ss_pred             CCEEEE
Confidence            666554


No 122
>KOG1034 consensus Transcriptional repressor EED/ESC/FIE, required for transcriptional silencing, WD repeat superfamily [Transcription]
Probab=99.09  E-value=4.6e-10  Score=132.04  Aligned_cols=158  Identities=19%  Similarity=0.235  Sum_probs=113.2

Q ss_pred             eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +|..|.|||+.+ +++|||.|.+|||||++++.|+..|.+++|       |.+.|-+|.|++||.+|||++.|.++++|+
T Consensus       137 sINeik~~p~~~qlvls~SkD~svRlwnI~~~~Cv~VfGG~eg-------HrdeVLSvD~~~~gd~i~ScGmDhslk~W~  209 (385)
T KOG1034|consen  137 SINEIKFHPDRPQLVLSASKDHSVRLWNIQTDVCVAVFGGVEG-------HRDEVLSVDFSLDGDRIASCGMDHSLKLWR  209 (385)
T ss_pred             cchhhhcCCCCCcEEEEecCCceEEEEeccCCeEEEEeccccc-------ccCcEEEEEEcCCCCeeeccCCcceEEEEe
Confidence            568889999864 899999999999999999999999976554       568899999999999999999999999999


Q ss_pred             CCCCC------cc----------------Ccccce-eeeecC--------------------------------------
Q 000080         2300 LEVGG------RS----------------NVRPME-SCLCFS-------------------------------------- 2318 (2389)
Q Consensus      2300 l~tgg------rs----------------~~k~l~-tl~gHs-------------------------------------- 2318 (2389)
                      +++..      ++                .+-|.+ +-.-|.                                      
T Consensus       210 l~~~~f~~~lE~s~~~~~~~t~~pfpt~~~~fp~fst~diHrnyVDCvrw~gd~ilSkscenaI~~w~pgkl~e~~~~vk  289 (385)
T KOG1034|consen  210 LNVKEFKNKLELSITYSPNKTTRPFPTPKTHFPDFSTTDIHRNYVDCVRWFGDFILSKSCENAIVCWKPGKLEESIHNVK  289 (385)
T ss_pred             cChhHHhhhhhhhcccCCCCccCcCCccccccccccccccccchHHHHHHHhhheeecccCceEEEEecchhhhhhhccC
Confidence            98320      00                000000 001111                                      


Q ss_pred             ----------------CCeeE--EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec--CcEEEEeecccc
Q 000080         2319 ----------------SHAMD--VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE--GLYDLFLPLKLL 2378 (2389)
Q Consensus      2319 ----------------~~V~s--VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~--~~V~svA~~~~~ 2378 (2389)
                                      ..++-  .+|.| =+++||.+   ...+.|.+||+.........+|..+.  ..|+..+++++|
T Consensus       290 p~es~~Ti~~~~~~~~c~iWfirf~~d~-~~~~la~g---nq~g~v~vwdL~~~ep~~~ttl~~s~~~~tVRQ~sfS~dg  365 (385)
T KOG1034|consen  290 PPESATTILGEFDYPMCDIWFIRFAFDP-WQKMLALG---NQSGKVYVWDLDNNEPPKCTTLTHSKSGSTVRQTSFSRDG  365 (385)
T ss_pred             CCccceeeeeEeccCccceEEEEEeecH-HHHHHhhc---cCCCcEEEEECCCCCCccCceEEeccccceeeeeeecccC
Confidence                            12222  34445 45778875   47899999998421111234555443  347799999999


Q ss_pred             hhhhccccccC
Q 000080         2379 NFALSKCRCLF 2389 (2389)
Q Consensus      2379 ~~~~s~~~~~~ 2389 (2389)
                      ...|--|.|.+
T Consensus       366 s~lv~vcdd~~  376 (385)
T KOG1034|consen  366 SILVLVCDDGT  376 (385)
T ss_pred             cEEEEEeCCCc
Confidence            99999998864


No 123
>KOG0288 consensus WD40 repeat protein TipD [General function prediction only]
Probab=99.08  E-value=9.6e-10  Score=132.09  Aligned_cols=166  Identities=16%  Similarity=0.166  Sum_probs=121.1

Q ss_pred             eeccccccccccccccCCCC--cC-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCC
Q 000080         2197 SALGWETQDDFEDYVDPPAT--VE-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALAS 2273 (2389)
Q Consensus      2197 sg~~~d~~~~~~~~~d~~at--v~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~ 2273 (2389)
                      +| ++|-+.+.|+......+  +- .-.+..|..+  +..++||-.|++||+||.+++.++.+.   |++        +.
T Consensus       278 sg-s~DRtiK~WDl~k~~C~kt~l~~S~cnDI~~~--~~~~~SgH~DkkvRfwD~Rs~~~~~sv---~~g--------g~  343 (459)
T KOG0288|consen  278 SG-SADRTIKLWDLQKAYCSKTVLPGSQCNDIVCS--ISDVISGHFDKKVRFWDIRSADKTRSV---PLG--------GR  343 (459)
T ss_pred             ec-cccchhhhhhhhhhheeccccccccccceEec--ceeeeecccccceEEEeccCCceeeEe---ecC--------cc
Confidence            44 66667777766422111  10 0012444555  667999999999999999999887765   222        58


Q ss_pred             EEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeec--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2274 ISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCF--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2274 V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gH--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |++|..+++|..+.|.+.|.|+++-|+++.+   ++..++-.|.  ....+.+.||| ||.++|+|   |.||.|.||++
T Consensus       344 vtSl~ls~~g~~lLsssRDdtl~viDlRt~e---I~~~~sA~g~k~asDwtrvvfSp-d~~YvaAG---S~dgsv~iW~v  416 (459)
T KOG0288|consen  344 VTSLDLSMDGLELLSSSRDDTLKVIDLRTKE---IRQTFSAEGFKCASDWTRVVFSP-DGSYVAAG---SADGSVYIWSV  416 (459)
T ss_pred             eeeEeeccCCeEEeeecCCCceeeeeccccc---EEEEeeccccccccccceeEECC-CCceeeec---cCCCcEEEEEc
Confidence            9999999999999999999999999999852   2222222221  12366799999 99999985   68999999999


Q ss_pred             CCCCCCceEEEEee-cC-cEEEEeecccchhhhccc
Q 000080         2352 LAPPTSSRASITCH-EG-LYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2352 l~~tg~~v~sL~GH-~~-~V~svA~~~~~~~~~s~~ 2385 (2389)
                      .  ++++...+... .+ +|.+++..|.|.-.||--
T Consensus       417 ~--tgKlE~~l~~s~s~~aI~s~~W~~sG~~Llsad  450 (459)
T KOG0288|consen  417 F--TGKLEKVLSLSTSNAAITSLSWNPSGSGLLSAD  450 (459)
T ss_pred             c--CceEEEEeccCCCCcceEEEEEcCCCchhhccc
Confidence            4  78887666543 33 699999999999998853


No 124
>TIGR03866 PQQ_ABC_repeats PQQ-dependent catabolism-associated beta-propeller protein. Members of this protein family consist of seven repeats each of the YVTN family beta-propeller repeat (see TIGR02276). Members occur invariably as part of a transport operon that is associated with PQQ-dependent catabolism of alcohols such as phenylethanol.
Probab=99.08  E-value=1.3e-09  Score=123.48  Aligned_cols=130  Identities=12%  Similarity=0.065  Sum_probs=98.8

Q ss_pred             CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEeCCCcEEEeeCCCCCccCcc
Q 000080         2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus      2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
                      +..++|++.|++|++||..+++.+.++.   ++        ..+++++|+|||+.+ ++++.|++|++||+.++.     
T Consensus         1 ~~~~~s~~~d~~v~~~d~~t~~~~~~~~---~~--------~~~~~l~~~~dg~~l~~~~~~~~~v~~~d~~~~~-----   64 (300)
T TIGR03866         1 EKAYVSNEKDNTISVIDTATLEVTRTFP---VG--------QRPRGITLSKDGKLLYVCASDSDTIQVIDLATGE-----   64 (300)
T ss_pred             CcEEEEecCCCEEEEEECCCCceEEEEE---CC--------CCCCceEECCCCCEEEEEECCCCeEEEEECCCCc-----
Confidence            3578999999999999999999888774   11        336789999999876 678889999999999862     


Q ss_pred             cceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2310 PMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2310 ~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      ....+..+.. +..++|+| +|+.++.++  +.|++|++||+  .+.+.+..+.. ...+.+++++|+|++++.
T Consensus        65 ~~~~~~~~~~-~~~~~~~~-~g~~l~~~~--~~~~~l~~~d~--~~~~~~~~~~~-~~~~~~~~~~~dg~~l~~  131 (300)
T TIGR03866        65 VIGTLPSGPD-PELFALHP-NGKILYIAN--EDDNLVTVIDI--ETRKVLAEIPV-GVEPEGMAVSPDGKIVVN  131 (300)
T ss_pred             EEEeccCCCC-ccEEEECC-CCCEEEEEc--CCCCeEEEEEC--CCCeEEeEeeC-CCCcceEEECCCCCEEEE
Confidence            3344444433 56799999 888776543  57899999998  34556666663 334678999999987653


No 125
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=99.08  E-value=1.1e-09  Score=140.60  Aligned_cols=171  Identities=17%  Similarity=0.128  Sum_probs=121.4

Q ss_pred             cccccceeeccccccccccccccC--CCCcCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2190 GYAGIGASALGWETQDDFEDYVDP--PATVEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2190 g~~~~~Asg~~~d~~~~~~~~~d~--~atv~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      |.+.+.|-| +.|+..++-..-|.  +.++..  .+|..|+|+|++.+||+.+-||+|++||+.++.+..++..++..+ 
T Consensus       106 g~g~~iaag-sdD~~vK~~~~~D~s~~~~lrgh~apVl~l~~~p~~~fLAvss~dG~v~iw~~~~~~~~~tl~~v~k~n-  183 (933)
T KOG1274|consen  106 GSGKMIAAG-SDDTAVKLLNLDDSSQEKVLRGHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDLQDGILSKTLTGVDKDN-  183 (933)
T ss_pred             cCCcEEEee-cCceeEEEEeccccchheeecccCCceeeeeEcCCCCEEEEEecCceEEEEEcccchhhhhcccCCccc-
Confidence            444455556 55655555544322  222333  367999999999999999999999999999999988876433222 


Q ss_pred             CCCCC--CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCCCCEEEEeecCC
Q 000080         2266 PPPYA--LASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSS 2341 (2389)
Q Consensus      2266 p~~GH--~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS 2341 (2389)
                         +.  ..-+..++|+|+|..||..+.|++|++++.+...     +.+.+..  |+..+.+++|+| .|++||++   +
T Consensus       184 ---~~~~s~i~~~~aW~Pk~g~la~~~~d~~Vkvy~r~~we-----~~f~Lr~~~~ss~~~~~~wsP-nG~YiAAs---~  251 (933)
T KOG1274|consen  184 ---EFILSRICTRLAWHPKGGTLAVPPVDNTVKVYSRKGWE-----LQFKLRDKLSSSKFSDLQWSP-NGKYIAAS---T  251 (933)
T ss_pred             ---cccccceeeeeeecCCCCeEEeeccCCeEEEEccCCce-----eheeecccccccceEEEEEcC-CCcEEeee---c
Confidence               11  2346779999999999999999999999998763     2222222  444488999999 89999986   5


Q ss_pred             CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2342 NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2342 ~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      .||.|-|||+-  +.. +   .--...|.|+|+.|.+|.
T Consensus       252 ~~g~I~vWnv~--t~~-~---~~~~~~Vc~~aw~p~~n~  284 (933)
T KOG1274|consen  252 LDGQILVWNVD--THE-R---HEFKRAVCCEAWKPNANA  284 (933)
T ss_pred             cCCcEEEEecc--cch-h---ccccceeEEEecCCCCCe
Confidence            89999999982  211 1   112245778888887764


No 126
>KOG0278 consensus Serine/threonine kinase receptor-associated protein [Lipid transport and metabolism]
Probab=99.07  E-value=5.9e-11  Score=135.39  Aligned_cols=139  Identities=8%  Similarity=0.090  Sum_probs=121.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|++.+.+.|...-|||+.|-|.|+||.-+|..+.+|+           |..-|.+|+|+.|.+.|.+|+.+.-+|++|+
T Consensus        61 avw~~~l~~na~~aasaaadftakvw~a~tgdelhsf~-----------hkhivk~~af~~ds~~lltgg~ekllrvfdl  129 (334)
T KOG0278|consen   61 AVWSATLNKNATRAASAAADFTAKVWDAVTGDELHSFE-----------HKHIVKAVAFSQDSNYLLTGGQEKLLRVFDL  129 (334)
T ss_pred             ceeeeecCchhhhhhhhcccchhhhhhhhhhhhhhhhh-----------hhheeeeEEecccchhhhccchHHHhhhhhc
Confidence            46888999999999999999999999999999999885           5677999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +...    -|.....||++.|+.+-|-..| +.|.|+   ++|+||||||.  .+++.+++|+ -...|+++-.+.+|+.
T Consensus       130 n~p~----App~E~~ghtg~Ir~v~wc~eD-~~iLSS---add~tVRLWD~--rTgt~v~sL~-~~s~VtSlEvs~dG~i  198 (334)
T KOG0278|consen  130 NRPK----APPKEISGHTGGIRTVLWCHED-KCILSS---ADDKTVRLWDH--RTGTEVQSLE-FNSPVTSLEVSQDGRI  198 (334)
T ss_pred             cCCC----CCchhhcCCCCcceeEEEeccC-ceEEee---ccCCceEEEEe--ccCcEEEEEe-cCCCCcceeeccCCCE
Confidence            9863    4667889999999999999844 666664   59999999998  5888999998 4556888888888876


Q ss_pred             h
Q 000080         2381 A 2381 (2389)
Q Consensus      2381 ~ 2381 (2389)
                      +
T Consensus       199 l  199 (334)
T KOG0278|consen  199 L  199 (334)
T ss_pred             E
Confidence            4


No 127
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=99.05  E-value=2.2e-09  Score=124.80  Aligned_cols=145  Identities=13%  Similarity=0.123  Sum_probs=117.2

Q ss_pred             eeEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC---EEEEEeCCCcE
Q 000080         2220 ISTRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH---RFASAALDGTV 2295 (2389)
Q Consensus      2220 i~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~---~LASgS~DgTV 2295 (2389)
                      -.|.++-|=| |--.+.|+|.|.++|+||..+-+...+|.      |     .+.|++-+.||-.-   .+|+|..|-.|
T Consensus       102 y~iss~~WyP~DtGmFtssSFDhtlKVWDtnTlQ~a~~F~------m-----e~~VYshamSp~a~sHcLiA~gtr~~~V  170 (397)
T KOG4283|consen  102 YAISSAIWYPIDTGMFTSSSFDHTLKVWDTNTLQEAVDFK------M-----EGKVYSHAMSPMAMSHCLIAAGTRDVQV  170 (397)
T ss_pred             eeeeeeEEeeecCceeecccccceEEEeecccceeeEEee------c-----CceeehhhcChhhhcceEEEEecCCCcE
Confidence            4667888888 55589999999999999999888877774      2     26799999998763   78889999999


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE------------
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT------------ 2363 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~------------ 2363 (2389)
                      ||-|+.+|.     .-.+++||.+.|.+|.|+|.+.-+||||   |.|++||+||+..+ ..|...|.            
T Consensus       171 rLCDi~SGs-----~sH~LsGHr~~vlaV~Wsp~~e~vLatg---saDg~irlWDiRra-sgcf~~lD~hn~k~~p~~~~  241 (397)
T KOG4283|consen  171 RLCDIASGS-----FSHTLSGHRDGVLAVEWSPSSEWVLATG---SADGAIRLWDIRRA-SGCFRVLDQHNTKRPPILKT  241 (397)
T ss_pred             EEEeccCCc-----ceeeeccccCceEEEEeccCceeEEEec---CCCceEEEEEeecc-cceeEEeecccCccCccccc
Confidence            999999983     5578999999999999999665677775   68999999998533 23433333            


Q ss_pred             --eecCcEEEEeecccchhhhcc
Q 000080         2364 --CHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2364 --GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                        .|.+.|..+|..-+|+..+++
T Consensus       242 n~ah~gkvngla~tSd~~~l~~~  264 (397)
T KOG4283|consen  242 NTAHYGKVNGLAWTSDARYLASC  264 (397)
T ss_pred             cccccceeeeeeecccchhhhhc
Confidence              466889999999999987765


No 128
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=99.03  E-value=1.9e-09  Score=126.34  Aligned_cols=116  Identities=16%  Similarity=0.195  Sum_probs=93.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|-.+-..-++.+|+|+|.|++|-||+.. |+.+.+..   ..       ...-+.-+.||||+++|+++---.|++|.+
T Consensus       189 ~~i~iGiA~~~k~imsas~dt~i~lw~lk-Gq~L~~id---tn-------q~~n~~aavSP~GRFia~~gFTpDVkVwE~  257 (420)
T KOG2096|consen  189 DIINIGIAGNAKYIMSASLDTKICLWDLK-GQLLQSID---TN-------QSSNYDAAVSPDGRFIAVSGFTPDVKVWEP  257 (420)
T ss_pred             ceEEEeecCCceEEEEecCCCcEEEEecC-Cceeeeec---cc-------cccccceeeCCCCcEEEEecCCCCceEEEE
Confidence            34456677789999999999999999985 99887763   11       133466789999999999999999999987


Q ss_pred             CCC---CccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2301 EVG---GRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2301 ~tg---grs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      --+   .-.-....+++.||+..|..+|||| +.+.++|+   |.||++||||+
T Consensus       258 ~f~kdG~fqev~rvf~LkGH~saV~~~aFsn-~S~r~vtv---SkDG~wriwdt  307 (420)
T KOG2096|consen  258 IFTKDGTFQEVKRVFSLKGHQSAVLAAAFSN-SSTRAVTV---SKDGKWRIWDT  307 (420)
T ss_pred             EeccCcchhhhhhhheeccchhheeeeeeCC-CcceeEEE---ecCCcEEEeec
Confidence            322   1112345788999999999999999 88999998   69999999997


No 129
>KOG1063 consensus RNA polymerase II elongator complex, subunit ELP2, WD repeat superfamily [Chromatin structure and dynamics; Transcription]
Probab=99.03  E-value=9.6e-10  Score=137.79  Aligned_cols=144  Identities=15%  Similarity=0.114  Sum_probs=110.3

Q ss_pred             eeEEEEEEcCCCCeEEEEeC-----CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080         2220 ISTRAFSSHPLRPFFLVGSS-----NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~-----DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
                      -.|.+++.+|+|+++||+--     ---|+||+..+=..++.+          .||+-.|+.++|||||++|+|+|.|+|
T Consensus       526 yEv~~l~~s~~gnliASaCKS~~~ehAvI~lw~t~~W~~~~~L----------~~HsLTVT~l~FSpdg~~LLsvsRDRt  595 (764)
T KOG1063|consen  526 YEVYALAISPTGNLIASACKSSLKEHAVIRLWNTANWLQVQEL----------EGHSLTVTRLAFSPDGRYLLSVSRDRT  595 (764)
T ss_pred             eeEEEEEecCCCCEEeehhhhCCccceEEEEEeccchhhhhee----------cccceEEEEEEECCCCcEEEEeecCce
Confidence            46799999999999999763     345899998766665544          257788999999999999999999999


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceE--EEEeecCcEEEE
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRA--SITCHEGLYDLF 2372 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~--sL~GH~~~V~sv 2372 (2389)
                      ++||...... ..-..+.....|+..|++..|+| ++..+|||   |.|++|++|..-..+.+++.  ...-|...|+.+
T Consensus       596 ~sl~~~~~~~-~~e~~fa~~k~HtRIIWdcsW~p-de~~FaTa---SRDK~VkVW~~~~~~d~~i~~~a~~~~~~aVTAv  670 (764)
T KOG1063|consen  596 VSLYEVQEDI-KDEFRFACLKAHTRIIWDCSWSP-DEKYFATA---SRDKKVKVWEEPDLRDKYISRFACLKFSLAVTAV  670 (764)
T ss_pred             EEeeeeeccc-chhhhhccccccceEEEEcccCc-ccceeEEe---cCCceEEEEeccCchhhhhhhhchhccCCceeeE
Confidence            9999875431 11122344678999999999999 99999997   79999999997322224432  233478888888


Q ss_pred             eecccc
Q 000080         2373 LPLKLL 2378 (2389)
Q Consensus      2373 A~~~~~ 2378 (2389)
                      +..+.-
T Consensus       671 ~~~~~~  676 (764)
T KOG1063|consen  671 AYLPVD  676 (764)
T ss_pred             Eeeccc
Confidence            776643


No 130
>KOG0639 consensus Transducin-like enhancer of split protein (contains WD40 repeats) [Chromatin structure and dynamics]
Probab=99.03  E-value=5.1e-10  Score=135.91  Aligned_cols=139  Identities=19%  Similarity=0.283  Sum_probs=119.3

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .+++.+||.+...++-.||.|++||+.+...++.|+          ||.+.+.+|.+|+||..|=||+.|+|||-||+++
T Consensus       513 yALa~spDakvcFsccsdGnI~vwDLhnq~~Vrqfq----------GhtDGascIdis~dGtklWTGGlDntvRcWDlre  582 (705)
T KOG0639|consen  513 YALAISPDAKVCFSCCSDGNIAVWDLHNQTLVRQFQ----------GHTDGASCIDISKDGTKLWTGGLDNTVRCWDLRE  582 (705)
T ss_pred             hhhhcCCccceeeeeccCCcEEEEEcccceeeeccc----------CCCCCceeEEecCCCceeecCCCccceeehhhhh
Confidence            789999999999999999999999999888888884          6789999999999999999999999999999998


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      +.     .+..+ .++..|.++.+.| +|.+||.|   =+.++|.|=-+   ++...+-|.-|+.-|-+|-|..-|.|-+
T Consensus       583 gr-----qlqqh-dF~SQIfSLg~cP-~~dWlavG---Mens~vevlh~---skp~kyqlhlheScVLSlKFa~cGkwfv  649 (705)
T KOG0639|consen  583 GR-----QLQQH-DFSSQIFSLGYCP-TGDWLAVG---MENSNVEVLHT---SKPEKYQLHLHESCVLSLKFAYCGKWFV  649 (705)
T ss_pred             hh-----hhhhh-hhhhhheecccCC-Cccceeee---cccCcEEEEec---CCccceeecccccEEEEEEecccCceee
Confidence            72     22222 3668899999999 99999974   37788888775   3445677777999999999999999988


Q ss_pred             cc
Q 000080         2383 SK 2384 (2389)
Q Consensus      2383 s~ 2384 (2389)
                      |.
T Consensus       650 St  651 (705)
T KOG0639|consen  650 ST  651 (705)
T ss_pred             ec
Confidence            74


No 131
>KOG0303 consensus Actin-binding protein Coronin, contains WD40 repeats [Cytoskeleton]
Probab=99.03  E-value=3.4e-09  Score=126.92  Aligned_cols=144  Identities=18%  Similarity=0.265  Sum_probs=114.3

Q ss_pred             ccccccceeeccccccccccccccCCCC---------cCc--eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeE
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDPPAT---------VEN--ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATAT 2256 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~at---------v~n--i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~T 2256 (2389)
                      |=-|-..||| +-|.+..+|+.-+.-.+         +.+  =+|--|+|||..+ .|+|+|.|.+|.|||+++|+.+.+
T Consensus        91 PfnD~vIASg-SeD~~v~vW~IPe~~l~~~ltepvv~L~gH~rrVg~V~wHPtA~NVLlsag~Dn~v~iWnv~tgeali~  169 (472)
T KOG0303|consen   91 PFNDCVIASG-SEDTKVMVWQIPENGLTRDLTEPVVELYGHQRRVGLVQWHPTAPNVLLSAGSDNTVSIWNVGTGEALIT  169 (472)
T ss_pred             ccCCceeecC-CCCceEEEEECCCcccccCcccceEEEeecceeEEEEeecccchhhHhhccCCceEEEEeccCCceeee
Confidence            5567788999 99999999987322222         111  1567789999866 799999999999999999999888


Q ss_pred             ecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCee-EEEEecCCCCEEE
Q 000080         2257 YGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAM-DVSYITSSGSVIA 2335 (2389)
Q Consensus      2257 l~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~-sVAFSP~DGslLA 2335 (2389)
                      +.           |.+.|+++.||-||.+|++++.|..||+||.+++.     .+..-.+|.+.=. .+.|.. +|. |+
T Consensus       170 l~-----------hpd~i~S~sfn~dGs~l~TtckDKkvRv~dpr~~~-----~v~e~~~heG~k~~Raifl~-~g~-i~  231 (472)
T KOG0303|consen  170 LD-----------HPDMVYSMSFNRDGSLLCTTCKDKKVRVIDPRRGT-----VVSEGVAHEGAKPARAIFLA-SGK-IF  231 (472)
T ss_pred             cC-----------CCCeEEEEEeccCCceeeeecccceeEEEcCCCCc-----EeeecccccCCCcceeEEec-cCc-ee
Confidence            73           56899999999999999999999999999999973     4444467775433 466887 888 77


Q ss_pred             EeecCC-CCCeEEEeeC
Q 000080         2336 AAGHSS-NGINVVVWDT 2351 (2389)
Q Consensus      2336 SAG~sS-~D~TVrLWD~ 2351 (2389)
                      |+|++- .++++-|||.
T Consensus       232 tTGfsr~seRq~aLwdp  248 (472)
T KOG0303|consen  232 TTGFSRMSERQIALWDP  248 (472)
T ss_pred             eeccccccccceeccCc
Confidence            888754 7899999996


No 132
>KOG0294 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.02  E-value=3.2e-09  Score=124.73  Aligned_cols=165  Identities=18%  Similarity=0.187  Sum_probs=119.2

Q ss_pred             ceeeccccccccccccccC--CCC--cCceeEEEEEEcCCCC--eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC
Q 000080         2195 GASALGWETQDDFEDYVDP--PAT--VENISTRAFSSHPLRP--FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP 2268 (2389)
Q Consensus      2195 ~Asg~~~d~~~~~~~~~d~--~at--v~ni~VrsVAFsPdG~--~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~ 2268 (2389)
                      .||| +-|+++.+-+....  ..+  .+..+|.++.|.|+..  .|+||++||.|.+|+.+.=.++.+++          
T Consensus        56 ~aSG-ssDetI~IYDm~k~~qlg~ll~HagsitaL~F~~~~S~shLlS~sdDG~i~iw~~~~W~~~~slK----------  124 (362)
T KOG0294|consen   56 VASG-SSDETIHIYDMRKRKQLGILLSHAGSITALKFYPPLSKSHLLSGSDDGHIIIWRVGSWELLKSLK----------  124 (362)
T ss_pred             Eecc-CCCCcEEEEeccchhhhcceeccccceEEEEecCCcchhheeeecCCCcEEEEEcCCeEEeeeec----------
Confidence            5667 66666666655311  111  1224679999999876  89999999999999997777888885          


Q ss_pred             CCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCcc---Ccccceee-----ee------------------------
Q 000080         2269 YALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRS---NVRPMESC-----LC------------------------ 2316 (2389)
Q Consensus      2269 GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs---~~k~l~tl-----~g------------------------ 2316 (2389)
                      +|.+.|+.|++.|.|+.-.|.+.|+++++||+-+|...   +++...++     +|                        
T Consensus       125 ~H~~~Vt~lsiHPS~KLALsVg~D~~lr~WNLV~Gr~a~v~~L~~~at~v~w~~~Gd~F~v~~~~~i~i~q~d~A~v~~~  204 (362)
T KOG0294|consen  125 AHKGQVTDLSIHPSGKLALSVGGDQVLRTWNLVRGRVAFVLNLKNKATLVSWSPQGDHFVVSGRNKIDIYQLDNASVFRE  204 (362)
T ss_pred             ccccccceeEecCCCceEEEEcCCceeeeehhhcCccceeeccCCcceeeEEcCCCCEEEEEeccEEEEEecccHhHhhh
Confidence            35677999999999999999999999999999876320   00000000     00                        


Q ss_pred             --cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2317 --FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2317 --Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                        .+..+.++.|-  ++..|++||   +|++|++||+.  ...+...+.+|+++|-.+++-+.
T Consensus       205 i~~~~r~l~~~~l--~~~~L~vG~---d~~~i~~~D~d--s~~~~~~~~AH~~RVK~i~~~~~  260 (362)
T KOG0294|consen  205 IENPKRILCATFL--DGSELLVGG---DNEWISLKDTD--SDTPLTEFLAHENRVKDIASYTN  260 (362)
T ss_pred             hhccccceeeeec--CCceEEEec---CCceEEEeccC--CCccceeeecchhheeeeEEEec
Confidence              11223444454  567888875   89999999984  36778999999999999987654


No 133
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=99.02  E-value=3.1e-09  Score=128.85  Aligned_cols=172  Identities=17%  Similarity=0.226  Sum_probs=130.3

Q ss_pred             cccceeeccccccccccccc--cCCCCcC--ceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCce-eeEecccCCCCC
Q 000080         2192 AGIGASALGWETQDDFEDYV--DPPATVE--NISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANV 2265 (2389)
Q Consensus      2192 ~~~~Asg~~~d~~~~~~~~~--d~~atv~--ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~ 2265 (2389)
                      ..++||| +-|.+..+|+..  .+.+++.  +-.|.+++|||.-+ +|++||.|++|+|.|.+...+ -..+++      
T Consensus       256 ~nVLaSg-saD~TV~lWD~~~g~p~~s~~~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R~~~~s~~~wk~------  328 (463)
T KOG0270|consen  256 RNVLASG-SADKTVKLWDVDTGKPKSSITHHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCRDPSNSGKEWKF------  328 (463)
T ss_pred             ceeEEec-CCCceEEEEEcCCCCcceehhhcCCceeEEEecCCCceEEEeccccceEEeeeccCccccCceEEe------
Confidence            3689999 999999999986  4444443  34679999999755 899999999999999984332 222331      


Q ss_pred             CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC
Q 000080         2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI 2344 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~ 2344 (2389)
                           .+.|-.|++.|.. +.|.++..||+|+=.|++..+    +|+.++..|...|.++++++..-.+++|+   |.|+
T Consensus       329 -----~g~VEkv~w~~~se~~f~~~tddG~v~~~D~R~~~----~~vwt~~AHd~~ISgl~~n~~~p~~l~t~---s~d~  396 (463)
T KOG0270|consen  329 -----DGEVEKVAWDPHSENSFFVSTDDGTVYYFDIRNPG----KPVWTLKAHDDEISGLSVNIQTPGLLSTA---STDK  396 (463)
T ss_pred             -----ccceEEEEecCCCceeEEEecCCceEEeeecCCCC----CceeEEEeccCCcceEEecCCCCcceeec---cccc
Confidence                 2669999999986 788889999999999999865    79999999999999999998777789886   5999


Q ss_pred             eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2345 NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2345 TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      +|+||++.....+.++.-.---+...|.++.|+-.+.|
T Consensus       397 ~Vklw~~~~~~~~~v~~~~~~~~rl~c~~~~~~~a~~l  434 (463)
T KOG0270|consen  397 VVKLWKFDVDSPKSVKEHSFKLGRLHCFALDPDVAFTL  434 (463)
T ss_pred             eEEEEeecCCCCcccccccccccceeecccCCCcceEE
Confidence            99999985333333322221223355666666655544


No 134
>KOG1446 consensus Histone H3 (Lys4) methyltransferase complex and RNA cleavage factor II complex, subunit SWD2 [RNA processing and modification; Chromatin structure and dynamics; Posttranslational modification, protein turnover, chaperones]
Probab=99.01  E-value=4.5e-09  Score=123.77  Aligned_cols=164  Identities=15%  Similarity=0.133  Sum_probs=126.6

Q ss_pred             cccccccccccccCCCC--cCc--eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2200 GWETQDDFEDYVDPPAT--VEN--ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2200 ~~d~~~~~~~~~d~~at--v~n--i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      .+|++.|+-...|...-  ..+  -.|.+|+.+|-+..++|||.|++|||||++..+|.--+..            ..=.
T Consensus        77 k~d~tIryLsl~dNkylRYF~GH~~~V~sL~~sP~~d~FlS~S~D~tvrLWDlR~~~cqg~l~~------------~~~p  144 (311)
T KOG1446|consen   77 KEDDTIRYLSLHDNKYLRYFPGHKKRVNSLSVSPKDDTFLSSSLDKTVRLWDLRVKKCQGLLNL------------SGRP  144 (311)
T ss_pred             CCCCceEEEEeecCceEEEcCCCCceEEEEEecCCCCeEEecccCCeEEeeEecCCCCceEEec------------CCCc
Confidence            67777777766433111  111  2568999999999999999999999999998888665531            1124


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeee---ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCL---CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~---gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .+||+|.|-.||.|...+.|+|+|++.-++   .|+.++.   +-......+.||| ||+.|.-+   ...+.+.|-|. 
T Consensus       145 i~AfDp~GLifA~~~~~~~IkLyD~Rs~dk---gPF~tf~i~~~~~~ew~~l~FS~-dGK~iLls---T~~s~~~~lDA-  216 (311)
T KOG1446|consen  145 IAAFDPEGLIFALANGSELIKLYDLRSFDK---GPFTTFSITDNDEAEWTDLEFSP-DGKSILLS---TNASFIYLLDA-  216 (311)
T ss_pred             ceeECCCCcEEEEecCCCeEEEEEecccCC---CCceeEccCCCCccceeeeEEcC-CCCEEEEE---eCCCcEEEEEc-
Confidence            679999999999999999999999998642   3555432   3356778999999 89977753   57888999997 


Q ss_pred             CCCCCceEEEEeecCcE---EEEeecccchhhhcc
Q 000080         2353 APPTSSRASITCHEGLY---DLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2353 ~~tg~~v~sL~GH~~~V---~svA~~~~~~~~~s~ 2384 (2389)
                       -+|...+++++|++.-   -+-.+.|+|.|+|+-
T Consensus       217 -f~G~~~~tfs~~~~~~~~~~~a~ftPds~Fvl~g  250 (311)
T KOG1446|consen  217 -FDGTVKSTFSGYPNAGNLPLSATFTPDSKFVLSG  250 (311)
T ss_pred             -cCCcEeeeEeeccCCCCcceeEEECCCCcEEEEe
Confidence             4677789999999876   488899999999874


No 135
>KOG0270 consensus WD40 repeat-containing protein [Function unknown]
Probab=98.99  E-value=2.3e-09  Score=129.90  Aligned_cols=136  Identities=17%  Similarity=0.186  Sum_probs=109.0

Q ss_pred             EEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeCC
Q 000080         2224 AFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2224 sVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl~ 2301 (2389)
                      +++|+-+ ...|||||.|.||+|||+.+|++.+++.          .|...|.+++|.|. +..|.+||.|+||+|-|++
T Consensus       248 ~Ls~n~~~~nVLaSgsaD~TV~lWD~~~g~p~~s~~----------~~~k~Vq~l~wh~~~p~~LLsGs~D~~V~l~D~R  317 (463)
T KOG0270|consen  248 ALSWNRNFRNVLASGSADKTVKLWDVDTGKPKSSIT----------HHGKKVQTLEWHPYEPSVLLSGSYDGTVALKDCR  317 (463)
T ss_pred             HHHhccccceeEEecCCCceEEEEEcCCCCcceehh----------hcCCceeEEEecCCCceEEEeccccceEEeeecc
Confidence            4455555 3479999999999999999999999873          36789999999988 5899999999999999999


Q ss_pred             CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      ....+  .....   ..+.|..|+|.|.+-..+.+ |  ++||+|+=.|+. ..++++.+++.|.++|.+|..+..-
T Consensus       318 ~~~~s--~~~wk---~~g~VEkv~w~~~se~~f~~-~--tddG~v~~~D~R-~~~~~vwt~~AHd~~ISgl~~n~~~  385 (463)
T KOG0270|consen  318 DPSNS--GKEWK---FDGEVEKVAWDPHSENSFFV-S--TDDGTVYYFDIR-NPGKPVWTLKAHDDEISGLSVNIQT  385 (463)
T ss_pred             Ccccc--CceEE---eccceEEEEecCCCceeEEE-e--cCCceEEeeecC-CCCCceeEEEeccCCcceEEecCCC
Confidence            53211  11122   45789999999955444444 3  699999999996 5679999999999999988877653


No 136
>KOG0641 consensus WD40 repeat protein [General function prediction only]
Probab=98.99  E-value=4.3e-09  Score=118.80  Aligned_cols=145  Identities=15%  Similarity=0.212  Sum_probs=119.0

Q ss_pred             ccccceeeccccccccccccc--cCCCCcC---------ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080         2191 YAGIGASALGWETQDDFEDYV--DPPATVE---------NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~--d~~atv~---------ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
                      ..-|-||| +-|.++|+|+..  .-+++++         +-.|.+|+..|.|++|+||-.|....|+|++-|+.++.|. 
T Consensus       193 n~~m~~sg-sqdktirfwdlrv~~~v~~l~~~~~~~glessavaav~vdpsgrll~sg~~dssc~lydirg~r~iq~f~-  270 (350)
T KOG0641|consen  193 NGAMFASG-SQDKTIRFWDLRVNSCVNTLDNDFHDGGLESSAVAAVAVDPSGRLLASGHADSSCMLYDIRGGRMIQRFH-  270 (350)
T ss_pred             cCcEEEcc-CCCceEEEEeeeccceeeeccCcccCCCcccceeEEEEECCCcceeeeccCCCceEEEEeeCCceeeeeC-
Confidence            45688999 889999999884  2233333         3368999999999999999999999999999999999883 


Q ss_pred             cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080         2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus      2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
                            |   |++.|++|.|||...++.++|.|..|||=|+.-. ....-++.-...|...+-.+.|+|.+=+.|.|   
T Consensus       271 ------p---hsadir~vrfsp~a~yllt~syd~~ikltdlqgd-la~el~~~vv~ehkdk~i~~rwh~~d~sfiss---  337 (350)
T KOG0641|consen  271 ------P---HSADIRCVRFSPGAHYLLTCSYDMKIKLTDLQGD-LAHELPIMVVAEHKDKAIQCRWHPQDFSFISS---  337 (350)
T ss_pred             ------C---CccceeEEEeCCCceEEEEecccceEEEeecccc-hhhcCceEEEEeccCceEEEEecCccceeeec---
Confidence                  1   7899999999999999999999999999999732 11223556667799999999999966566644   


Q ss_pred             CCCCCeEEEeeC
Q 000080         2340 SSNGINVVVWDT 2351 (2389)
Q Consensus      2340 sS~D~TVrLWD~ 2351 (2389)
                       |.|+|+.||-+
T Consensus       338 -sadkt~tlwa~  348 (350)
T KOG0641|consen  338 -SADKTATLWAL  348 (350)
T ss_pred             -cCcceEEEecc
Confidence             68999999975


No 137
>KOG2096 consensus WD40 repeat protein [General function prediction only]
Probab=98.98  E-value=1.5e-08  Score=119.04  Aligned_cols=210  Identities=17%  Similarity=0.211  Sum_probs=141.5

Q ss_pred             CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe
Q 000080           36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA  115 (2389)
Q Consensus        36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS  115 (2389)
                      +|...+.-++|+.|  |. .+|-++++..++.|  + ..+|+...--++||.+|.- |   -+.|+|.||   -..++.+
T Consensus        84 gH~~~vt~~~FsSd--GK-~lat~~~Dr~Ir~w--~-~~DF~~~eHr~~R~nve~d-h---pT~V~FapD---c~s~vv~  150 (420)
T KOG2096|consen   84 GHKKEVTDVAFSSD--GK-KLATISGDRSIRLW--D-VRDFENKEHRCIRQNVEYD-H---PTRVVFAPD---CKSVVVS  150 (420)
T ss_pred             ccCCceeeeEEcCC--Cc-eeEEEeCCceEEEE--e-cchhhhhhhhHhhccccCC-C---ceEEEECCC---cceEEEE
Confidence            67788888999998  74 67888999999998  4 4456654445778998764 5   689999998   5556643


Q ss_pred             --cCCeEEEEeeCCCCC-CCCccceeeEEe----cccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeecc
Q 000080          116 --SENCIFVFAHDSASS-KGSFCWSQNAIL----VQGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKEN  186 (2389)
Q Consensus       116 --yDntIRVw~~d~~~~-kgd~~W~~~~tL----~hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~  186 (2389)
                        .++++++|+.+...+ ++.+.......+    .|.-.|-+|--...|.+|+||+.|  |.||+.....-..+   ...
T Consensus       151 ~~~g~~l~vyk~~K~~dG~~~~~~v~~D~~~f~~kh~v~~i~iGiA~~~k~imsas~dt~i~lw~lkGq~L~~i---dtn  227 (420)
T KOG2096|consen  151 VKRGNKLCVYKLVKKTDGSGSHHFVHIDNLEFERKHQVDIINIGIAGNAKYIMSASLDTKICLWDLKGQLLQSI---DTN  227 (420)
T ss_pred             EccCCEEEEEEeeecccCCCCcccccccccccchhcccceEEEeecCCceEEEEecCCCcEEEEecCCceeeee---ccc
Confidence              579999998763211 122222222222    156667778889999999999997  99999763333322   222


Q ss_pred             ccceEEEEeecCCCc-eEeeec--ccccccCCCCCCCceeEEEeeCCCccce---eecccCCCCeeEEEeccCCCCCCCC
Q 000080          187 YPQNLVSATWSIEGP-SATAAS--MSQLDLLGPKEAGKCVFICCSDGKSEYI---KLELCHPQPVSMVQWRPSTRRHSPG  260 (2389)
Q Consensus       187 ~~~~ivsvaWSpdG~-fATag~--dikf~~~~~~~~~kpV~V~~~dg~~~~~---~ve~aH~qdVn~V~W~Ps~~~~~~~  260 (2389)
                      . -+-+.++=||+|. +|+||-  |++  +|      +|+  +..||+.+..   +...+|...|-..+++|        
T Consensus       228 q-~~n~~aavSP~GRFia~~gFTpDVk--Vw------E~~--f~kdG~fqev~rvf~LkGH~saV~~~aFsn--------  288 (420)
T KOG2096|consen  228 Q-SSNYDAAVSPDGRFIAVSGFTPDVK--VW------EPI--FTKDGTFQEVKRVFSLKGHQSAVLAAAFSN--------  288 (420)
T ss_pred             c-ccccceeeCCCCcEEEEecCCCCce--EE------EEE--eccCcchhhhhhhheeccchhheeeeeeCC--------
Confidence            2 2334445599999 666655  544  11      111  1124443222   23589999999999999        


Q ss_pred             CCccccCceEEeeecCCeEEEEEee
Q 000080          261 DTKRSQRHVLLTCCLDGTVRLWCEM  285 (2389)
Q Consensus       261 Dgk~~~~nILAScSdDgTVRLW~e~  285 (2389)
                      ++.+     .+|.|.||++|||+.+
T Consensus       289 ~S~r-----~vtvSkDG~wriwdtd  308 (420)
T KOG2096|consen  289 SSTR-----AVTVSKDGKWRIWDTD  308 (420)
T ss_pred             Ccce-----eEEEecCCcEEEeecc
Confidence            4444     9999999999999955


No 138
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.97  E-value=8.4e-10  Score=136.10  Aligned_cols=120  Identities=16%  Similarity=0.252  Sum_probs=99.1

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLW 2298 (2389)
                      -|..+.|.| |.+.||.|.+||.|+||-+..+..-.... .|..  -..+|...|+++.|.|-. +.||+++.|.||+||
T Consensus       629 ~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a~gl~e~~~-tPe~--~lt~h~eKI~slRfHPLAadvLa~asyd~Ti~lW  705 (1012)
T KOG1445|consen  629 LVTDLHWDPFDDERLAVATDDGQINLWRLTANGLPENEM-TPEK--ILTIHGEKITSLRFHPLAADVLAVASYDSTIELW  705 (1012)
T ss_pred             eeeecccCCCChHHeeecccCceEEEEEeccCCCCcccC-Ccce--eeecccceEEEEEecchhhhHhhhhhccceeeee
Confidence            468889999 67789999999999999987664321111 0111  134678999999999985 899999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      |+.++     +....+.||++.|.++|||| ||+++||.   +.|++||+++..
T Consensus       706 Dl~~~-----~~~~~l~gHtdqIf~~AWSp-dGr~~AtV---cKDg~~rVy~Pr  750 (1012)
T KOG1445|consen  706 DLANA-----KLYSRLVGHTDQIFGIAWSP-DGRRIATV---CKDGTLRVYEPR  750 (1012)
T ss_pred             ehhhh-----hhhheeccCcCceeEEEECC-CCcceeee---ecCceEEEeCCC
Confidence            99987     45678899999999999999 99999998   499999999973


No 139
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.96  E-value=3.7e-09  Score=122.93  Aligned_cols=144  Identities=13%  Similarity=0.150  Sum_probs=112.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce-eeEecccCCCCCCCCCCCCCEEEEEECC--CCCEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAANVPPPYALASISALQFDH--YGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSP--DG~~LASgS~DgTVkL 2297 (2389)
                      .|.+|-|+||+.-+|+- .|..|-+|++..+.. ++.+. .++    ..+|....++=++||  ||+.+|+.+ |+|++.
T Consensus       125 ~i~cvew~Pns~klasm-~dn~i~l~~l~ess~~vaev~-ss~----s~e~~~~ftsg~WspHHdgnqv~tt~-d~tl~~  197 (370)
T KOG1007|consen  125 KINCVEWEPNSDKLASM-DDNNIVLWSLDESSKIVAEVL-SSE----SAEMRHSFTSGAWSPHHDGNQVATTS-DSTLQF  197 (370)
T ss_pred             ceeeEEEcCCCCeeEEe-ccCceEEEEcccCcchheeec-ccc----cccccceecccccCCCCccceEEEeC-CCcEEE
Confidence            45899999999999986 488999999988875 33332 112    234567788889998  799999876 699999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      ||++|..    +...--.+|...|+++.|+|+--.+|||+|   +|+-|||||+. .+...++.|.+|+.+||+|-+.|.
T Consensus       198 ~D~RT~~----~~~sI~dAHgq~vrdlDfNpnkq~~lvt~g---DdgyvriWD~R-~tk~pv~el~~HsHWvW~VRfn~~  269 (370)
T KOG1007|consen  198 WDLRTMK----KNNSIEDAHGQRVRDLDFNPNKQHILVTCG---DDGYVRIWDTR-KTKFPVQELPGHSHWVWAVRFNPE  269 (370)
T ss_pred             EEccchh----hhcchhhhhcceeeeccCCCCceEEEEEcC---CCccEEEEecc-CCCccccccCCCceEEEEEEecCc
Confidence            9999863    222223568889999999995555788865   99999999996 345569999999999999999886


Q ss_pred             ch
Q 000080         2378 LN 2379 (2389)
Q Consensus      2378 ~~ 2379 (2389)
                      -+
T Consensus       270 hd  271 (370)
T KOG1007|consen  270 HD  271 (370)
T ss_pred             cc
Confidence            44


No 140
>KOG4328 consensus WD40 protein [Function unknown]
Probab=98.96  E-value=2.6e-09  Score=129.68  Aligned_cols=161  Identities=18%  Similarity=0.179  Sum_probs=118.6

Q ss_pred             CCcCceeEEEEEEcCCCC--eEEEEeCCCcEEEeecCCCcee-eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEe
Q 000080         2215 ATVENISTRAFSSHPLRP--FFLVGSSNTHIYLWEFGKDKAT-ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAA 2290 (2389)
Q Consensus      2215 atv~ni~VrsVAFsPdG~--~LASGS~DgTIRLWDl~tGk~l-~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS 2290 (2389)
                      +-+..-+|.+++|||.-+  ++|+|.--|+|-+||+++.+.. ....  -+     .+|+..|.++.|+|.. .++.+.|
T Consensus       182 ~kv~~~Rit~l~fHPt~~~~lva~GdK~G~VG~Wn~~~~~~d~d~v~--~f-----~~hs~~Vs~l~F~P~n~s~i~ssS  254 (498)
T KOG4328|consen  182 AKVTDRRITSLAFHPTENRKLVAVGDKGGQVGLWNFGTQEKDKDGVY--LF-----TPHSGPVSGLKFSPANTSQIYSSS  254 (498)
T ss_pred             eEecccceEEEEecccCcceEEEEccCCCcEEEEecCCCCCccCceE--Ee-----ccCCccccceEecCCChhheeeec
Confidence            334444779999999765  8999999999999999532221 1111  11     2478999999999986 7999999


Q ss_pred             CCCcEEEeeCCCCCc----------------------------------------cCcccceeeeecCCCeeEEEEecCC
Q 000080         2291 LDGTVCTWQLEVGGR----------------------------------------SNVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggr----------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
                      .|||||+=|++.+.-                                        ..-..+..+.-|...|.+|+++|-.
T Consensus       255 yDGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~lh~kKI~sv~~NP~~  334 (498)
T KOG4328|consen  255 YDGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLRLHKKKITSVALNPVC  334 (498)
T ss_pred             cCceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhhhhhcccceeecCCCC
Confidence            999999988875410                                        0001223344588899999999977


Q ss_pred             CCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEEEEeecccchhhhccc
Q 000080         2331 GSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2331 GslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      -.+||||   |.|+|+||||+..-.++.  +-+...|.-.|.+..+||+|-..|..|
T Consensus       335 p~~laT~---s~D~T~kIWD~R~l~~K~sp~lst~~HrrsV~sAyFSPs~gtl~TT~  388 (498)
T KOG4328|consen  335 PWFLATA---SLDQTAKIWDLRQLRGKASPFLSTLPHRRSVNSAYFSPSGGTLLTTC  388 (498)
T ss_pred             chheeec---ccCcceeeeehhhhcCCCCcceecccccceeeeeEEcCCCCceEeec
Confidence            7899997   599999999985322222  233445999999999999998888766


No 141
>KOG1445 consensus Tumor-specific antigen (contains WD repeats) [Cytoskeleton]
Probab=98.96  E-value=3.4e-09  Score=130.90  Aligned_cols=150  Identities=17%  Similarity=0.236  Sum_probs=119.6

Q ss_pred             EEcCCCCeEEE--EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCC
Q 000080         2226 SSHPLRPFFLV--GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2226 AFsPdG~~LAS--GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~t 2302 (2389)
                      -|+.+..++|.  +|..|.|-|+|+...-.+      |+.-||..-...-|+.++++|-. ++||.|.+||.|+||.+.+
T Consensus       586 Gfcan~~rvAVPL~g~gG~iai~el~~PGrL------PDgv~p~l~Ngt~vtDl~WdPFD~~rLAVa~ddg~i~lWr~~a  659 (1012)
T KOG1445|consen  586 GFCANNKRVAVPLAGSGGVIAIYELNEPGRL------PDGVMPGLFNGTLVTDLHWDPFDDERLAVATDDGQINLWRLTA  659 (1012)
T ss_pred             ceeeccceEEEEecCCCceEEEEEcCCCCCC------CcccccccccCceeeecccCCCChHHeeecccCceEEEEEecc
Confidence            47777777665  567889999999754332      23233433344679999999864 8999999999999999988


Q ss_pred             CCcc--CcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2303 GGRS--NVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2303 ggrs--~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +|.+  ...|-..+.+|...|+++.|+|=-..+||++   |.|-||+|||+  ++++..-+|+||+++|-.+|-||+|+.
T Consensus       660 ~gl~e~~~tPe~~lt~h~eKI~slRfHPLAadvLa~a---syd~Ti~lWDl--~~~~~~~~l~gHtdqIf~~AWSpdGr~  734 (1012)
T KOG1445|consen  660 NGLPENEMTPEKILTIHGEKITSLRFHPLAADVLAVA---SYDSTIELWDL--ANAKLYSRLVGHTDQIFGIAWSPDGRR  734 (1012)
T ss_pred             CCCCcccCCcceeeecccceEEEEEecchhhhHhhhh---hccceeeeeeh--hhhhhhheeccCcCceeEEEECCCCcc
Confidence            7521  1134456889999999999999766788887   68999999998  566777899999999999999999999


Q ss_pred             hhcccc
Q 000080         2381 ALSKCR 2386 (2389)
Q Consensus      2381 ~~s~~~ 2386 (2389)
                      +-+-|.
T Consensus       735 ~AtVcK  740 (1012)
T KOG1445|consen  735 IATVCK  740 (1012)
T ss_pred             eeeeec
Confidence            999885


No 142
>COG2319 FOG: WD40 repeat [General function prediction only]
Probab=98.95  E-value=1.3e-08  Score=114.28  Aligned_cols=139  Identities=20%  Similarity=0.325  Sum_probs=110.0

Q ss_pred             EEEEEE-cCCCC-eEEEEeC-CCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEE
Q 000080         2222 TRAFSS-HPLRP-FFLVGSS-NTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVC 2296 (2389)
Q Consensus      2222 VrsVAF-sPdG~-~LASGS~-DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVk 2296 (2389)
                      +..+.+ ++++. +++..+. |+++++||+.. +.....+.          +|...|..++|+|+|+.+++++. |++++
T Consensus       112 ~~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~~~~~~~~----------~~~~~v~~~~~~~~~~~~~~~~~~~~~~~  181 (466)
T COG2319         112 VSKLALSSPDGNSILLASSSLDGTVKLWDLSTPGKLIRTLE----------GHSESVTSLAFSPDGKLLASGSSLDGTIK  181 (466)
T ss_pred             eeeEEEECCCcceEEeccCCCCccEEEEEecCCCeEEEEEe----------cCcccEEEEEECCCCCEEEecCCCCCceE
Confidence            455566 89998 5665455 99999999976 55555553          46688999999999999999986 99999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEee
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLP 2374 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~ 2374 (2389)
                      +|++.++     ..+.++.+|...|.+++|+| +|. .++++   +.|++|++||..  .+..+. .+.+|...+ .-.+
T Consensus       182 ~~~~~~~-----~~~~~~~~~~~~v~~~~~~~-~~~~~~~~~---~~d~~i~~wd~~--~~~~~~~~~~~~~~~~-~~~~  249 (466)
T COG2319         182 LWDLRTG-----KPLSTLAGHTDPVSSLAFSP-DGGLLIASG---SSDGTIRLWDLS--TGKLLRSTLSGHSDSV-VSSF  249 (466)
T ss_pred             EEEcCCC-----ceEEeeccCCCceEEEEEcC-CcceEEEEe---cCCCcEEEEECC--CCcEEeeecCCCCcce-eEeE
Confidence            9999974     46778888999999999998 887 55542   589999999873  566677 799999986 4477


Q ss_pred             cccchhhh
Q 000080         2375 LKLLNFAL 2382 (2389)
Q Consensus      2375 ~~~~~~~~ 2382 (2389)
                      ++++.+.+
T Consensus       250 ~~~~~~~~  257 (466)
T COG2319         250 SPDGSLLA  257 (466)
T ss_pred             CCCCCEEE
Confidence            77775444


No 143
>KOG0305 consensus Anaphase promoting complex, Cdc20, Cdh1, and Ama1 subunits [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=98.95  E-value=1.3e-08  Score=127.46  Aligned_cols=203  Identities=16%  Similarity=0.315  Sum_probs=137.9

Q ss_pred             ccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcE
Q 000080           33 IPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQL  112 (2389)
Q Consensus        33 ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeI  112 (2389)
                      +--.|..-.+.++|...     .+..|+++..++-+  +     .+.-....+ ++.+|.  +.|+..+|+||    +..
T Consensus       255 ~~~~h~~rvg~laW~~~-----~lssGsr~~~I~~~--d-----vR~~~~~~~-~~~~H~--qeVCgLkws~d----~~~  315 (484)
T KOG0305|consen  255 LRGSHASRVGSLAWNSS-----VLSSGSRDGKILNH--D-----VRISQHVVS-TLQGHR--QEVCGLKWSPD----GNQ  315 (484)
T ss_pred             ccCCcCceeEEEeccCc-----eEEEecCCCcEEEE--E-----Eecchhhhh-hhhccc--ceeeeeEECCC----CCe
Confidence            33347888899999943     67777777766555  2     111111222 456664  58999999998    555


Q ss_pred             EEe--cCCeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEE-EEec--c--eEEeeccCCcEE-EEEEe
Q 000080          113 AAA--SENCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIV-AGGM--E--TVLWKKKNTLWE-IAWKF  183 (2389)
Q Consensus       113 aAS--yDntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLa-Sggd--D--V~IW~~~~s~We-cvwt~  183 (2389)
                      +||  .||.+.||...        +.....++ .|+..|.+++|.|--..|+ +||.  |  +++|+..++.-. ++   
T Consensus       316 lASGgnDN~~~Iwd~~--------~~~p~~~~~~H~aAVKA~awcP~q~~lLAsGGGs~D~~i~fwn~~~g~~i~~v---  384 (484)
T KOG0305|consen  316 LASGGNDNVVFIWDGL--------SPEPKFTFTEHTAAVKALAWCPWQSGLLATGGGSADRCIKFWNTNTGARIDSV---  384 (484)
T ss_pred             eccCCCccceEeccCC--------CccccEEEeccceeeeEeeeCCCccCceEEcCCCcccEEEEEEcCCCcEeccc---
Confidence            554  48999999864        12223333 5999999999999877555 6655  2  999997755432 23   


Q ss_pred             eccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCC
Q 000080          184 KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDT  262 (2389)
Q Consensus       184 ~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dg  262 (2389)
                        +..--|-++.||+... |+|+-+...          +-+-||.+.. ........+|+..|-..+|+|        ||
T Consensus       385 --dtgsQVcsL~Wsk~~kEi~sthG~s~----------n~i~lw~~ps-~~~~~~l~gH~~RVl~la~SP--------dg  443 (484)
T KOG0305|consen  385 --DTGSQVCSLIWSKKYKELLSTHGYSE----------NQITLWKYPS-MKLVAELLGHTSRVLYLALSP--------DG  443 (484)
T ss_pred             --ccCCceeeEEEcCCCCEEEEecCCCC----------CcEEEEeccc-cceeeeecCCcceeEEEEECC--------CC
Confidence              2223355889999986 888877532          1233343322 222334589999999999999        88


Q ss_pred             ccccCceEEeeecCCeEEEEEeecCCccc
Q 000080          263 KRSQRHVLLTCCLDGTVRLWCEMDSGKTR  291 (2389)
Q Consensus       263 k~~~~nILAScSdDgTVRLW~e~d~Gk~k  291 (2389)
                      ..     ++|++.|.|+|+|..-+..+.+
T Consensus       444 ~~-----i~t~a~DETlrfw~~f~~~~~~  467 (484)
T KOG0305|consen  444 ET-----IVTGAADETLRFWNLFDERPKS  467 (484)
T ss_pred             CE-----EEEecccCcEEeccccCCCCcc
Confidence            88     9999999999999988865543


No 144
>KOG1539 consensus WD repeat protein [General function prediction only]
Probab=98.94  E-value=2.2e-09  Score=136.62  Aligned_cols=142  Identities=19%  Similarity=0.303  Sum_probs=113.9

Q ss_pred             ccccccceeeccccccccccccccC--CCCcC-ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDP--PATVE-NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~--~atv~-ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      -|-.....++ +.+..-.+|+|...  ..+++ ..++..+..|.....+|.+-+|-.|++.|..+-+-++.|.       
T Consensus       502 D~~n~~~vsa-~~~Gilkfw~f~~k~l~~~l~l~~~~~~iv~hr~s~l~a~~~ddf~I~vvD~~t~kvvR~f~-------  573 (910)
T KOG1539|consen  502 DGTNRLLVSA-GADGILKFWDFKKKVLKKSLRLGSSITGIVYHRVSDLLAIALDDFSIRVVDVVTRKVVREFW-------  573 (910)
T ss_pred             cCCCceEEEc-cCcceEEEEecCCcceeeeeccCCCcceeeeeehhhhhhhhcCceeEEEEEchhhhhhHHhh-------
Confidence            3344456667 78888899999633  23332 2456778899999999999999999999998888887774       


Q ss_pred             CCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080         2266 PPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
                         ||.+.|++..|||||++|++++.|+|||+||+-++.     .+-. ......+.++.||| +|.+|||+-  .+.+-
T Consensus       574 ---gh~nritd~~FS~DgrWlisasmD~tIr~wDlpt~~-----lID~-~~vd~~~~sls~SP-ngD~LAT~H--vd~~g  641 (910)
T KOG1539|consen  574 ---GHGNRITDMTFSPDGRWLISASMDSTIRTWDLPTGT-----LIDG-LLVDSPCTSLSFSP-NGDFLATVH--VDQNG  641 (910)
T ss_pred             ---ccccceeeeEeCCCCcEEEEeecCCcEEEEeccCcc-----eeee-EecCCcceeeEECC-CCCEEEEEE--ecCce
Confidence               578999999999999999999999999999999973     3333 23567888999999 999999983  34477


Q ss_pred             EEEee
Q 000080         2346 VVVWD 2350 (2389)
Q Consensus      2346 VrLWD 2350 (2389)
                      |.||-
T Consensus       642 IylWs  646 (910)
T KOG1539|consen  642 IYLWS  646 (910)
T ss_pred             EEEEE
Confidence            99997


No 145
>PF08662 eIF2A:  Eukaryotic translation initiation factor eIF2A;  InterPro: IPR013979  This entry contains beta propellor domains found in eukaryotic translation initiation factors and TolB domain-containing proteins. 
Probab=98.94  E-value=1.3e-08  Score=114.73  Aligned_cols=139  Identities=13%  Similarity=0.156  Sum_probs=99.6

Q ss_pred             EEEEEcCCCCeEEEEeC---C-------CcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-
Q 000080         2223 RAFSSHPLRPFFLVGSS---N-------THIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA- 2290 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~---D-------gTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS- 2290 (2389)
                      -.+.|||+|.+|+.-.+   |       +...||-++ .+..+..+.         ....+.|.+++|+|+|+.||... 
T Consensus         9 ~~~~W~~~G~~l~~~~~~~~~~~~ks~~~~~~l~~~~~~~~~~~~i~---------l~~~~~I~~~~WsP~g~~favi~g   79 (194)
T PF08662_consen    9 AKLHWQPSGDYLLVKVQTRVDKSGKSYYGEFELFYLNEKNIPVESIE---------LKKEGPIHDVAWSPNGNEFAVIYG   79 (194)
T ss_pred             EEEEecccCCEEEEEEEEeeccCcceEEeeEEEEEEecCCCccceee---------ccCCCceEEEEECcCCCEEEEEEc
Confidence            45789999997655333   1       235555552 222333332         11235699999999999987654 


Q ss_pred             -CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcE
Q 000080         2291 -LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLY 2369 (2389)
Q Consensus      2291 -~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V 2369 (2389)
                       .++.|.|||++.      +++.++  +...++.|.|+| +|++||+||++...|.|++||+.  +.+.+.+++ | ..+
T Consensus        80 ~~~~~v~lyd~~~------~~i~~~--~~~~~n~i~wsP-~G~~l~~~g~~n~~G~l~~wd~~--~~~~i~~~~-~-~~~  146 (194)
T PF08662_consen   80 SMPAKVTLYDVKG------KKIFSF--GTQPRNTISWSP-DGRFLVLAGFGNLNGDLEFWDVR--KKKKISTFE-H-SDA  146 (194)
T ss_pred             cCCcccEEEcCcc------cEeEee--cCCCceEEEECC-CCCEEEEEEccCCCcEEEEEECC--CCEEeeccc-c-CcE
Confidence             578999999973      355555  456788999999 99999999987777899999983  445565554 3 358


Q ss_pred             EEEeecccchhhhc
Q 000080         2370 DLFLPLKLLNFALS 2383 (2389)
Q Consensus      2370 ~svA~~~~~~~~~s 2383 (2389)
                      +.++.+|+|++.++
T Consensus       147 t~~~WsPdGr~~~t  160 (194)
T PF08662_consen  147 TDVEWSPDGRYLAT  160 (194)
T ss_pred             EEEEEcCCCCEEEE
Confidence            89999999999876


No 146
>KOG1274 consensus WD40 repeat protein [General function prediction only]
Probab=98.94  E-value=6.2e-09  Score=133.89  Aligned_cols=141  Identities=14%  Similarity=0.156  Sum_probs=111.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      ++|.++|+-+|.++|.||+|..||+=+..++....+++          ||.+.|.+|.|+|+|++||+.+.||+|++||+
T Consensus        98 p~r~~~v~g~g~~iaagsdD~~vK~~~~~D~s~~~~lr----------gh~apVl~l~~~p~~~fLAvss~dG~v~iw~~  167 (933)
T KOG1274|consen   98 PIRDLAVSGSGKMIAAGSDDTAVKLLNLDDSSQEKVLR----------GHDAPVLQLSYDPKGNFLAVSSCDGKVQIWDL  167 (933)
T ss_pred             cceEEEEecCCcEEEeecCceeEEEEeccccchheeec----------ccCCceeeeeEcCCCCEEEEEecCceEEEEEc
Confidence            45889999999999999999999999998888888876          57799999999999999999999999999999


Q ss_pred             CCCCccCcccceeeee--------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE--EeecCcEE
Q 000080         2301 EVGGRSNVRPMESCLC--------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI--TCHEGLYD 2370 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~g--------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL--~GH~~~V~ 2370 (2389)
                      .++.     ...++.+        -+..+.-++|+|++|++++-    +.|++|++++..  .......|  .-|...+.
T Consensus       168 ~~~~-----~~~tl~~v~k~n~~~~s~i~~~~aW~Pk~g~la~~----~~d~~Vkvy~r~--~we~~f~Lr~~~~ss~~~  236 (933)
T KOG1274|consen  168 QDGI-----LSKTLTGVDKDNEFILSRICTRLAWHPKGGTLAVP----PVDNTVKVYSRK--GWELQFKLRDKLSSSKFS  236 (933)
T ss_pred             ccch-----hhhhcccCCccccccccceeeeeeecCCCCeEEee----ccCCeEEEEccC--CceeheeecccccccceE
Confidence            9863     1122211        13456679999955666665    389999999972  33334444  34566699


Q ss_pred             EEeecccchhhh
Q 000080         2371 LFLPLKLLNFAL 2382 (2389)
Q Consensus      2371 svA~~~~~~~~~ 2382 (2389)
                      +++.+|.|.++-
T Consensus       237 ~~~wsPnG~YiA  248 (933)
T KOG1274|consen  237 DLQWSPNGKYIA  248 (933)
T ss_pred             EEEEcCCCcEEe
Confidence            999999998753


No 147
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=98.92  E-value=8.1e-09  Score=129.74  Aligned_cols=147  Identities=18%  Similarity=0.264  Sum_probs=116.4

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..||+++.+|.+..++.|++||.++..+.+.++.... +.+       +-..++|-+|+|+|+|.++|+|+.||.|++||
T Consensus       111 g~IWsiai~p~~~~l~IgcddGvl~~~s~~p~~I~~~-r~l-------~rq~sRvLslsw~~~~~~i~~Gs~Dg~Iriwd  182 (691)
T KOG2048|consen  111 GAIWSIAINPENTILAIGCDDGVLYDFSIGPDKITYK-RSL-------MRQKSRVLSLSWNPTGTKIAGGSIDGVIRIWD  182 (691)
T ss_pred             cceeEEEeCCccceEEeecCCceEEEEecCCceEEEE-eec-------ccccceEEEEEecCCccEEEecccCceEEEEE
Confidence            5679999999999999999999999999988875432 111       12358899999999999999999999999999


Q ss_pred             CCCCCccCccc-ceeeee----cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2300 LEVGGRSNVRP-MESCLC----FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2300 l~tggrs~~k~-l~tl~g----Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      +.++. .. +. ...+.+    -...|++|.|-. | ..||+|   -.-|+|+.||.  .+++.++++.+|.+.|.|+|.
T Consensus       183 ~~~~~-t~-~~~~~~~d~l~k~~~~iVWSv~~Lr-d-~tI~sg---DS~G~V~FWd~--~~gTLiqS~~~h~adVl~Lav  253 (691)
T KOG2048|consen  183 VKSGQ-TL-HIITMQLDRLSKREPTIVWSVLFLR-D-STIASG---DSAGTVTFWDS--IFGTLIQSHSCHDADVLALAV  253 (691)
T ss_pred             cCCCc-eE-EEeeecccccccCCceEEEEEEEee-c-CcEEEe---cCCceEEEEcc--cCcchhhhhhhhhcceeEEEE
Confidence            99873 11 10 011111    345789999997 6 457775   24589999997  578889999999999999999


Q ss_pred             cccchhhhc
Q 000080         2375 LKLLNFALS 2383 (2389)
Q Consensus      2375 ~~~~~~~~s 2383 (2389)
                      .+++|+..|
T Consensus       254 ~~~~d~vfs  262 (691)
T KOG2048|consen  254 ADNEDRVFS  262 (691)
T ss_pred             cCCCCeEEE
Confidence            999887665


No 148
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.91  E-value=5.9e-09  Score=126.09  Aligned_cols=144  Identities=15%  Similarity=0.200  Sum_probs=108.4

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      ..|+|+++|..+++|+.||++|+||+.+-..+...   +       .|...|..+.|||||++||+-+.| ..++||+++
T Consensus       148 k~vaf~~~gs~latgg~dg~lRv~~~Ps~~t~l~e---~-------~~~~eV~DL~FS~dgk~lasig~d-~~~VW~~~~  216 (398)
T KOG0771|consen  148 KVVAFNGDGSKLATGGTDGTLRVWEWPSMLTILEE---I-------AHHAEVKDLDFSPDGKFLASIGAD-SARVWSVNT  216 (398)
T ss_pred             eEEEEcCCCCEeeeccccceEEEEecCcchhhhhh---H-------hhcCccccceeCCCCcEEEEecCC-ceEEEEecc
Confidence            67899999999999999999999998655544333   1       355899999999999999999999 999999999


Q ss_pred             CCc----c----------------C----cc------c---c-----eeeee-----------cCCCeeEEEEecCCCCE
Q 000080         2303 GGR----S----------------N----VR------P---M-----ESCLC-----------FSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus      2303 ggr----s----------------~----~k------~---l-----~tl~g-----------Hs~~V~sVAFSP~DGsl 2333 (2389)
                      |-.    .                +    ++      +   +     ..+.+           --..|++++.+. ||++
T Consensus       217 g~~~a~~t~~~k~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~-dGkf  295 (398)
T KOG0771|consen  217 GAALARKTPFSKDEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSD-DGKF  295 (398)
T ss_pred             CchhhhcCCcccchhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcC-CCcE
Confidence            710    0                0    00      0   0     00000           013688999999 9999


Q ss_pred             EEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecCcEEEEeecccchhhhc
Q 000080         2334 IAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2334 LASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      +|-|   +.||.|-|.++.  .=++++-. +.|..-|+.|.++|+-+.-.|
T Consensus       296 ~AlG---T~dGsVai~~~~--~lq~~~~vk~aH~~~VT~ltF~Pdsr~~~s  341 (398)
T KOG0771|consen  296 LALG---TMDGSVAIYDAK--SLQRLQYVKEAHLGFVTGLTFSPDSRYLAS  341 (398)
T ss_pred             EEEe---ccCCcEEEEEec--eeeeeEeehhhheeeeeeEEEcCCcCcccc
Confidence            9986   589999999972  22333332 669999999999999876554


No 149
>KOG1007 consensus WD repeat protein TSSC1, WD repeat superfamily [Function unknown]
Probab=98.90  E-value=5.4e-09  Score=121.59  Aligned_cols=139  Identities=14%  Similarity=0.110  Sum_probs=112.3

Q ss_pred             EEEEEcC--CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080         2223 RAFSSHP--LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2223 rsVAFsP--dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
                      .+=+|+|  ||..+++. .|++++.||+++.++.....  .+       |...|+.+-|+|+- ..||||++||.||+||
T Consensus       174 tsg~WspHHdgnqv~tt-~d~tl~~~D~RT~~~~~sI~--dA-------Hgq~vrdlDfNpnkq~~lvt~gDdgyvriWD  243 (370)
T KOG1007|consen  174 TSGAWSPHHDGNQVATT-SDSTLQFWDLRTMKKNNSIE--DA-------HGQRVRDLDFNPNKQHILVTCGDDGYVRIWD  243 (370)
T ss_pred             cccccCCCCccceEEEe-CCCcEEEEEccchhhhcchh--hh-------hcceeeeccCCCCceEEEEEcCCCccEEEEe
Confidence            3447888  78888875 68999999999888766654  22       56889999999996 6899999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC--------------------------
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-------------------------- 2353 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-------------------------- 2353 (2389)
                      .+...    .|++++.+|+.+|++|.|+|.-.++|.|+   +.|..|-||-...                          
T Consensus       244 ~R~tk----~pv~el~~HsHWvW~VRfn~~hdqLiLs~---~SDs~V~Lsca~svSSE~qi~~~~dese~e~~dseer~k  316 (370)
T KOG1007|consen  244 TRKTK----FPVQELPGHSHWVWAVRFNPEHDQLILSG---GSDSAVNLSCASSVSSEQQIEFEDDESESEDEDSEERVK  316 (370)
T ss_pred             ccCCC----ccccccCCCceEEEEEEecCccceEEEec---CCCceeEEEeccccccccccccccccccCcchhhHHhcc
Confidence            99753    68999999999999999999767899986   4889999998511                          


Q ss_pred             -CCCCceEEEEeecCcEEEEeecccc
Q 000080         2354 -PPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2354 -~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                       -+...++++..|++.|+++|-|---
T Consensus       317 pL~dg~l~tydehEDSVY~~aWSsad  342 (370)
T KOG1007|consen  317 PLQDGQLETYDEHEDSVYALAWSSAD  342 (370)
T ss_pred             cccccccccccccccceEEEeeccCC
Confidence             0122356788899999998866533


No 150
>KOG4328 consensus WD40 protein [Function unknown]
Probab=98.89  E-value=2.6e-08  Score=121.34  Aligned_cols=145  Identities=15%  Similarity=0.212  Sum_probs=113.5

Q ss_pred             ccccceeeccccccccccccc----cCCCCc--CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce-eeEecccCCC
Q 000080         2191 YAGIGASALGWETQDDFEDYV----DPPATV--ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA-TATYGVLPAA 2263 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~----d~~atv--~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~-l~Tl~vl~gh 2263 (2389)
                      .+.+--+. +||.+.|+.+|.    +.+.+.  +++...++.|+.+.+.++.|..=|...+||.+++.. ..-++     
T Consensus       246 n~s~i~ss-SyDGtiR~~D~~~~i~e~v~s~~~d~~~fs~~d~~~e~~~vl~~~~~G~f~~iD~R~~~s~~~~~~-----  319 (498)
T KOG4328|consen  246 NTSQIYSS-SYDGTIRLQDFEGNISEEVLSLDTDNIWFSSLDFSAESRSVLFGDNVGNFNVIDLRTDGSEYENLR-----  319 (498)
T ss_pred             Chhheeee-ccCceeeeeeecchhhHHHhhcCccceeeeeccccCCCccEEEeecccceEEEEeecCCccchhhh-----
Confidence            44444555 899999999885    445555  456778899999999888888878999999998764 22222     


Q ss_pred             CCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCC
Q 000080         2264 NVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSN 2342 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~ 2342 (2389)
                           =|...|++|+|+|.- ..|||||.|+|+||||++.-+ ....|+.....|...|.++.|||.+|+ |+|.   +.
T Consensus       320 -----lh~kKI~sv~~NP~~p~~laT~s~D~T~kIWD~R~l~-~K~sp~lst~~HrrsV~sAyFSPs~gt-l~TT---~~  389 (498)
T KOG4328|consen  320 -----LHKKKITSVALNPVCPWFLATASLDQTAKIWDLRQLR-GKASPFLSTLPHRRSVNSAYFSPSGGT-LLTT---CQ  389 (498)
T ss_pred             -----hhhcccceeecCCCCchheeecccCcceeeeehhhhc-CCCCcceecccccceeeeeEEcCCCCc-eEee---cc
Confidence                 156789999999996 799999999999999998742 111256777789999999999996666 7776   48


Q ss_pred             CCeEEEeeC
Q 000080         2343 GINVVVWDT 2351 (2389)
Q Consensus      2343 D~TVrLWD~ 2351 (2389)
                      |.+|||||.
T Consensus       390 D~~IRv~ds  398 (498)
T KOG4328|consen  390 DNEIRVFDS  398 (498)
T ss_pred             CCceEEeec
Confidence            999999996


No 151
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.88  E-value=6.7e-08  Score=112.89  Aligned_cols=255  Identities=14%  Similarity=0.195  Sum_probs=152.2

Q ss_pred             ccccCCCCCCCCCCC-CCcccccccc-cccCCCCCCCcceeec--CCCCCCeEEEEec-----CCcEEEEeCCCCccccc
Q 000080            7 GCSLQNANPCVDPTE-HLPLAFLRSE-FIPTAPTRSTSTIDWL--PDFAGYSWVAYGA-----SSLLVISHFPSPLSQEE   77 (2389)
Q Consensus         7 ~~~~~~~~~~~~~~~-~lpl~~~~~~-~ip~ap~~~~~ai~wl--pD~~G~~~vAYas-----g~~vVI~~l~SP~~~~e   77 (2389)
                      +--.|+..++.+|++ .+|....+.+ ++.=---=..-++.|+  ||. . .++|.|+     .-.|=|+.|++-  +-|
T Consensus        11 ~i~~q~~~~~~s~i~~~~~~~~~r~~eiy~Y~ap~~lya~~Ws~~~~~-~-~rla~gS~~Ee~~Nkvqiv~ld~~--s~e   86 (364)
T KOG0290|consen   11 HIQDQQGRTYSSPIQRSSPEGNPRRKEIYTYNAPWPLYAMNWSVRPDK-K-FRLAVGSFIEEYNNKVQIVQLDED--SGE   86 (364)
T ss_pred             hhhhhhccccCCcccccCcccCcccceEEEecCCCceeeeccccCCCc-c-eeEEEeeeccccCCeeEEEEEccC--CCc
Confidence            334567777888854 3455544443 3322222345688998  663 3 5899884     334555565531  112


Q ss_pred             ccccccceeeeeccCCCCCeeEEEEcCCCC-CCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec------ccceEEE
Q 000080           78 ALIGPIFRQVFALSDNSLPVTSISWSPETP-SIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV------QGTKVEA  150 (2389)
Q Consensus        78 ~~~~p~~~Qviegh~d~~dVk~VaWSPd~~-~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~------hssTV~s  150 (2389)
                      .+.-    ..   -+|.++|+.+-|.|++- ..-+++|++++..|+|+-..+    +-.-.+...|.      +...+.+
T Consensus        87 ~~~~----a~---fd~~YP~tK~~wiPd~~g~~pdlLATs~D~LRlWri~~e----e~~~~~~~~L~~~kns~~~aPlTS  155 (364)
T KOG0290|consen   87 LVED----AN---FDHPYPVTKLMWIPDSKGVYPDLLATSSDFLRLWRIGDE----ESRVELQSVLNNNKNSEFCAPLTS  155 (364)
T ss_pred             eecc----CC---CCCCCCccceEecCCccccCcchhhcccCeEEEEeccCc----CCceehhhhhccCcccccCCcccc
Confidence            2200    11   14458999999999721 112688988899999986521    11223333332      3567888


Q ss_pred             EeecCCC-CeEEEEecc--eEEeeccCC-cEEEEEEeeccccceEEEEeecCCCc--eEeeecccc---cccC-------
Q 000080          151 IEWTGSG-DGIVAGGME--TVLWKKKNT-LWEIAWKFKENYPQNLVSATWSIEGP--SATAASMSQ---LDLL-------  214 (2389)
Q Consensus       151 IAWSpdG-~rLaSggdD--V~IW~~~~s-~Wecvwt~~~~~~~~ivsvaWSpdG~--fATag~dik---f~~~-------  214 (2389)
                      ..|+--- ++|.++|-|  ..||+...+ ....-.++ -.|...+|+++|+..|.  |||+|+|..   |...       
T Consensus       156 FDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQL-IAHDKEV~DIaf~~~s~~~FASvgaDGSvRmFDLR~leHSTI  234 (364)
T KOG0290|consen  156 FDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQL-IAHDKEVYDIAFLKGSRDVFASVGADGSVRMFDLRSLEHSTI  234 (364)
T ss_pred             cccccCCcceeEeecccCeEEEEEEeeccccceeeEE-EecCcceeEEEeccCccceEEEecCCCcEEEEEecccccceE
Confidence            8998644 566688887  679997665 22222222 24667889999999776  999999554   4332       


Q ss_pred             --CCCCCCceeEEEe---------------------eCCCccce--eecccCCCCeeEEEeccCCCCCCCCCCccccCce
Q 000080          215 --GPKEAGKCVFICC---------------------SDGKSEYI--KLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHV  269 (2389)
Q Consensus       215 --~~~~~~kpV~V~~---------------------~dg~~~~~--~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nI  269 (2389)
                        +.++.+.|..-..                     -|-.....  .....|..+||+|+|.|.            .++.
T Consensus       235 IYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPh------------S~~h  302 (364)
T KOG0290|consen  235 IYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPH------------SSSH  302 (364)
T ss_pred             EecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCC------------CCce
Confidence              1122122221100                     01011100  124789999999999994            2344


Q ss_pred             EEeeecCCeEEEEEeecCCc
Q 000080          270 LLTCCLDGTVRLWCEMDSGK  289 (2389)
Q Consensus       270 LAScSdDgTVRLW~e~d~Gk  289 (2389)
                      |.||+||-.+-||+....++
T Consensus       303 ictaGDD~qaliWDl~q~~~  322 (364)
T KOG0290|consen  303 ICTAGDDCQALIWDLQQMPR  322 (364)
T ss_pred             eeecCCcceEEEEecccccc
Confidence            99999999999999875433


No 152
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.87  E-value=5.1e-09  Score=137.17  Aligned_cols=176  Identities=16%  Similarity=0.195  Sum_probs=128.1

Q ss_pred             ccceeeccccccccccccccC--------CCC--cCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080         2193 GIGASALGWETQDDFEDYVDP--------PAT--VENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus      2193 ~~~Asg~~~d~~~~~~~~~d~--------~at--v~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
                      |+.|.| +-|..+.+++-...        +++  .+...|+.+.|+|.+. +||||++||.|-|||+.+-+.-.++    
T Consensus        81 GlIaGG-~edG~I~ly~p~~~~~~~~~~~la~~~~h~G~V~gLDfN~~q~nlLASGa~~geI~iWDlnn~~tP~~~----  155 (1049)
T KOG0307|consen   81 GLIAGG-LEDGNIVLYDPASIIANASEEVLATKSKHTGPVLGLDFNPFQGNLLASGADDGEILIWDLNKPETPFTP----  155 (1049)
T ss_pred             ceeecc-ccCCceEEecchhhccCcchHHHhhhcccCCceeeeeccccCCceeeccCCCCcEEEeccCCcCCCCCC----
Confidence            455555 55556666654321        122  2346889999999877 9999999999999999875543333    


Q ss_pred             CCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCC--CeeEEEEecCCCCEEEEee
Q 000080         2262 AANVPPPYALASISALQFDHY-GHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSS--HAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus      2262 gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~--~V~sVAFSP~DGslLASAG 2338 (2389)
                      + .   ....+.|.+|+++-. .+.||||+.+|++-+||++..     +++..+.-|.+  .+..++|+|++.+.|++|.
T Consensus       156 ~-~---~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~-----~pii~ls~~~~~~~~S~l~WhP~~aTql~~As  226 (1049)
T KOG0307|consen  156 G-S---QAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKK-----KPIIKLSDTPGRMHCSVLAWHPDHATQLLVAS  226 (1049)
T ss_pred             C-C---CCCcccceEeccchhhhHHhhccCCCCCceeccccCC-----CcccccccCCCccceeeeeeCCCCceeeeeec
Confidence            1 1   112378999999966 589999999999999999863     46655555554  5779999998777787764


Q ss_pred             cCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc-hhhhc
Q 000080         2339 HSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL-NFALS 2383 (2389)
Q Consensus      2339 ~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~-~~~~s 2383 (2389)
                      -+-.+-.|++||+..+ ...++.+++|+-+|.+++-.+.+ +..||
T Consensus       227 ~dd~~PviqlWDlR~a-ssP~k~~~~H~~GilslsWc~~D~~lllS  271 (1049)
T KOG0307|consen  227 GDDSAPVIQLWDLRFA-SSPLKILEGHQRGILSLSWCPQDPRLLLS  271 (1049)
T ss_pred             CCCCCceeEeeccccc-CCchhhhcccccceeeeccCCCCchhhhc
Confidence            2223346999998533 34589999999999999999998 55554


No 153
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.87  E-value=4.2e-09  Score=130.33  Aligned_cols=118  Identities=19%  Similarity=0.327  Sum_probs=95.2

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCC------C--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGK------D--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD 2292 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~t------G--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D 2292 (2389)
                      .||+++|||..+-|++++.|++|++|++..      +  +.+.||+          ||.+.|-||+.++.|+.+-||+.|
T Consensus       296 ~ir~l~~~~sep~lit~sed~~lk~WnLqk~~~s~~~~~epi~tfr----------aH~gPVl~v~v~~n~~~~ysgg~D  365 (577)
T KOG0642|consen  296 CIRALAFHPSEPVLITASEDGTLKLWNLQKAKKSAEKDVEPILTFR----------AHEGPVLCVVVPSNGEHCYSGGID  365 (577)
T ss_pred             hhhhhhcCCCCCeEEEeccccchhhhhhcccCCccccceeeeEEEe----------cccCceEEEEecCCceEEEeeccC
Confidence            359999999999999999999999999931      1  2356664          578999999999999999999999


Q ss_pred             CcEEEeeCCCCCc---cC--cccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2293 GTVCTWQLEVGGR---SN--VRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2293 gTVkLWDl~tggr---s~--~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      |+||.|++-....   +.  .....++.||...|+.++||+ .-..|++.   |.|+|||+|+..
T Consensus       366 g~I~~w~~p~n~dp~ds~dp~vl~~~l~Ghtdavw~l~~s~-~~~~Llsc---s~DgTvr~w~~~  426 (577)
T KOG0642|consen  366 GTIRCWNLPPNQDPDDSYDPSVLSGTLLGHTDAVWLLALSS-TKDRLLSC---SSDGTVRLWEPT  426 (577)
T ss_pred             ceeeeeccCCCCCcccccCcchhccceeccccceeeeeecc-cccceeee---cCCceEEeeccC
Confidence            9999996642110   00  012356899999999999998 66778885   689999999973


No 154
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=98.86  E-value=8.3e-09  Score=128.82  Aligned_cols=163  Identities=16%  Similarity=0.221  Sum_probs=118.1

Q ss_pred             cccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEE
Q 000080         2210 YVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFAS 2288 (2389)
Q Consensus      2210 ~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LAS 2288 (2389)
                      |.++.++-+-  |-.+.|-|-.-.|++++.|.|||+||+.+++++..- +       ..||...|.+++|.|+. ..|++
T Consensus        93 lk~~~aH~nA--ifDl~wapge~~lVsasGDsT~r~Wdvk~s~l~G~~-~-------~~GH~~SvkS~cf~~~n~~vF~t  162 (720)
T KOG0321|consen   93 LKKPLAHKNA--IFDLKWAPGESLLVSASGDSTIRPWDVKTSRLVGGR-L-------NLGHTGSVKSECFMPTNPAVFCT  162 (720)
T ss_pred             hcccccccce--eEeeccCCCceeEEEccCCceeeeeeeccceeecce-e-------ecccccccchhhhccCCCcceee
Confidence            4566666543  489999994447999999999999999999887651 1       13788999999999987 79999


Q ss_pred             EeCCCcEEEeeCCCCCc-------------cC-----c----ccceeeeecCCCeeE---EEEecCCCCEEEEeecCCCC
Q 000080         2289 AALDGTVCTWQLEVGGR-------------SN-----V----RPMESCLCFSSHAMD---VSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2289 gS~DgTVkLWDl~tggr-------------s~-----~----k~l~tl~gHs~~V~s---VAFSP~DGslLASAG~sS~D 2343 (2389)
                      |+.||.|.|||++..+.             -+     .    +.+.....|+..+.+   |.|.. |...|||||  ..|
T Consensus       163 GgRDg~illWD~R~n~~d~~e~~~~~~~~~~n~~ptpskp~~kr~~k~kA~s~ti~ssvTvv~fk-De~tlaSag--a~D  239 (720)
T KOG0321|consen  163 GGRDGEILLWDCRCNGVDALEEFDNRIYGRHNTAPTPSKPLKKRIRKWKAASNTIFSSVTVVLFK-DESTLASAG--AAD  239 (720)
T ss_pred             ccCCCcEEEEEEeccchhhHHHHhhhhhccccCCCCCCchhhccccccccccCceeeeeEEEEEe-ccceeeecc--CCC
Confidence            99999999999975320             00     0    112233456666776   77777 889999987  579


Q ss_pred             CeEEEeeCCCCCC----Cc--eEEEEee---cCcEEEEeecccchhhhccc
Q 000080         2344 INVVVWDTLAPPT----SS--RASITCH---EGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg----~~--v~sL~GH---~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      ++||+||+..+..    +.  +..+..|   .-++.++...-.|.+.+-.|
T Consensus       240 ~~iKVWDLRk~~~~~r~ep~~~~~~~t~skrs~G~~nL~lDssGt~L~AsC  290 (720)
T KOG0321|consen  240 STIKVWDLRKNYTAYRQEPRGSDKYPTHSKRSVGQVNLILDSSGTYLFASC  290 (720)
T ss_pred             cceEEEeecccccccccCCCcccCccCcccceeeeEEEEecCCCCeEEEEe
Confidence            9999999853211    11  2233334   45677888888888877666


No 155
>KOG0646 consensus WD40 repeat protein [General function prediction only]
Probab=98.85  E-value=1.9e-08  Score=122.76  Aligned_cols=159  Identities=15%  Similarity=0.172  Sum_probs=117.8

Q ss_pred             ccccccccccccccC-CCCcC-----ceeEEEEEEcCC--CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080         2199 LGWETQDDFEDYVDP-PATVE-----NISTRAFSSHPL--RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus      2199 ~~~d~~~~~~~~~d~-~atv~-----ni~VrsVAFsPd--G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
                      +.|..++-+.+..+. ++.+.     ..+|..+-..+-  ..+|+|+|.|.|||+||+..|..+.++. +     |    
T Consensus       148 ~vW~l~~lv~a~~~~~~~p~~~f~~HtlsITDl~ig~Gg~~~rl~TaS~D~t~k~wdlS~g~LLlti~-f-----p----  217 (476)
T KOG0646|consen  148 LVWLLTDLVSADNDHSVKPLHIFSDHTLSITDLQIGSGGTNARLYTASEDRTIKLWDLSLGVLLLTIT-F-----P----  217 (476)
T ss_pred             EEEEEEeecccccCCCccceeeeccCcceeEEEEecCCCccceEEEecCCceEEEEEeccceeeEEEe-c-----C----
Confidence            456666655555432 11111     135666655554  4589999999999999999999888864 1     1    


Q ss_pred             CCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCC--c---------cCcccceeeeecCC--CeeEEEEecCCCCEEEEe
Q 000080         2271 LASISALQFDHYGHRFASAALDGTVCTWQLEVGG--R---------SNVRPMESCLCFSS--HAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus      2271 ~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tgg--r---------s~~k~l~tl~gHs~--~V~sVAFSP~DGslLASA 2337 (2389)
                       ..+.+|+.+|-++.+-.|+.||.|.+-++..-.  +         .....+..+.||.+  .|++++++- ||++|+||
T Consensus       218 -~si~av~lDpae~~~yiGt~~G~I~~~~~~~~~~~~~~v~~k~~~~~~t~~~~~~Gh~~~~~ITcLais~-DgtlLlSG  295 (476)
T KOG0646|consen  218 -SSIKAVALDPAERVVYIGTEEGKIFQNLLFKLSGQSAGVNQKGRHEENTQINVLVGHENESAITCLAIST-DGTLLLSG  295 (476)
T ss_pred             -CcceeEEEcccccEEEecCCcceEEeeehhcCCcccccccccccccccceeeeeccccCCcceeEEEEec-CccEEEee
Confidence             558999999999999999999988877665421  0         01134566889998  999999999 99999996


Q ss_pred             ecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2338 GHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2338 G~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                         +.|++|+|||+  ...+|+++++--.+.|+-+..
T Consensus       296 ---d~dg~VcvWdi--~S~Q~iRtl~~~kgpVtnL~i  327 (476)
T KOG0646|consen  296 ---DEDGKVCVWDI--YSKQCIRTLQTSKGPVTNLQI  327 (476)
T ss_pred             ---CCCCCEEEEec--chHHHHHHHhhhccccceeEe
Confidence               59999999998  466788888766677776665


No 156
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=98.85  E-value=2.5e-08  Score=117.25  Aligned_cols=110  Identities=18%  Similarity=0.258  Sum_probs=93.4

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|.+|.|+|.+..|+.+|+||++|++|+....+...|+           |...+.+.+|-++ ..+++|+.||.||+.|+
T Consensus        15 ~IS~v~f~~~~~~LLvssWDgslrlYdv~~~~l~~~~~-----------~~~plL~c~F~d~-~~~~~G~~dg~vr~~Dl   82 (323)
T KOG1036|consen   15 GISSVKFSPSSSDLLVSSWDGSLRLYDVPANSLKLKFK-----------HGAPLLDCAFADE-STIVTGGLDGQVRRYDL   82 (323)
T ss_pred             ceeeEEEcCcCCcEEEEeccCcEEEEeccchhhhhhee-----------cCCceeeeeccCC-ceEEEeccCceEEEEEe
Confidence            46999999999999999999999999998776666664           4577999999985 68999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      +++      +...+.-|...|++|.+++..|.+| ||   |.|++|++||+.
T Consensus        83 n~~------~~~~igth~~~i~ci~~~~~~~~vI-sg---sWD~~ik~wD~R  124 (323)
T KOG1036|consen   83 NTG------NEDQIGTHDEGIRCIEYSYEVGCVI-SG---SWDKTIKFWDPR  124 (323)
T ss_pred             cCC------cceeeccCCCceEEEEeeccCCeEE-Ec---ccCccEEEEecc
Confidence            986      2345567999999999998666666 44   599999999984


No 157
>KOG4283 consensus Transcription-coupled repair protein CSA, contains WD40 domain [Transcription; Replication, recombination and repair]
Probab=98.84  E-value=1.2e-08  Score=118.82  Aligned_cols=147  Identities=12%  Similarity=0.232  Sum_probs=116.9

Q ss_pred             ccccccceeeccccccccccccccCCCCcC----ceeEEEEEEcCCCC---eEEEEeCCCcEEEeecCCCceeeEecccC
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDPPATVE----NISTRAFSSHPLRP---FFLVGSSNTHIYLWEFGKDKATATYGVLP 2261 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~atv~----ni~VrsVAFsPdG~---~LASGS~DgTIRLWDl~tGk~l~Tl~vl~ 2261 (2389)
                      |=.+||-.++ +.|.+-++|+.... .+..    .-.|.+-+++|-.-   +||+|-.|-.|||-|+.+|.+..++.   
T Consensus       111 P~DtGmFtss-SFDhtlKVWDtnTl-Q~a~~F~me~~VYshamSp~a~sHcLiA~gtr~~~VrLCDi~SGs~sH~Ls---  185 (397)
T KOG4283|consen  111 PIDTGMFTSS-SFDHTLKVWDTNTL-QEAVDFKMEGKVYSHAMSPMAMSHCLIAAGTRDVQVRLCDIASGSFSHTLS---  185 (397)
T ss_pred             eecCceeecc-cccceEEEeecccc-eeeEEeecCceeehhhcChhhhcceEEEEecCCCcEEEEeccCCcceeeec---
Confidence            6678888999 99999999987422 1111    02457778888543   89999999999999999999999984   


Q ss_pred             CCCCCCCCCCCCEEEEEECCCCC-EEEEEeCCCcEEEeeCCCC-Cc------c---CcccceeeeecCCCeeEEEEecCC
Q 000080         2262 AANVPPPYALASISALQFDHYGH-RFASAALDGTVCTWQLEVG-GR------S---NVRPMESCLCFSSHAMDVSYITSS 2330 (2389)
Q Consensus      2262 gh~~p~~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLWDl~tg-gr------s---~~k~l~tl~gHs~~V~sVAFSP~D 2330 (2389)
                             ||.+.|.+|.+||... .||+||.||+|||||++.. +.      .   .+..+++-..|.+.|+++||.. |
T Consensus       186 -------GHr~~vlaV~Wsp~~e~vLatgsaDg~irlWDiRrasgcf~~lD~hn~k~~p~~~~n~ah~gkvngla~tS-d  257 (397)
T KOG4283|consen  186 -------GHRDGVLAVEWSPSSEWVLATGSADGAIRLWDIRRASGCFRVLDQHNTKRPPILKTNTAHYGKVNGLAWTS-D  257 (397)
T ss_pred             -------cccCceEEEEeccCceeEEEecCCCceEEEEEeecccceeEEeecccCccCccccccccccceeeeeeecc-c
Confidence                   6789999999999975 7899999999999999864 10      0   1122344567889999999999 9


Q ss_pred             CCEEEEeecCCCCCeEEEeeC
Q 000080         2331 GSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2331 GslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |..+++.|   .|.-+|+|+.
T Consensus       258 ~~~l~~~g---td~r~r~wn~  275 (397)
T KOG4283|consen  258 ARYLASCG---TDDRIRVWNM  275 (397)
T ss_pred             chhhhhcc---CccceEEeec
Confidence            99999976   6778999997


No 158
>KOG1009 consensus Chromatin assembly complex 1 subunit B/CAC2 (contains WD40 repeats) [Chromatin structure and dynamics; Replication, recombination and repair]
Probab=98.83  E-value=4e-08  Score=118.55  Aligned_cols=156  Identities=16%  Similarity=0.271  Sum_probs=110.2

Q ss_pred             CCeeEEEEcCCCCCCC-cEEE-ecCCeEEEEeeCC-CCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eE
Q 000080           95 LPVTSISWSPETPSIG-QLAA-ASENCIFVFAHDS-ASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TV  168 (2389)
Q Consensus        95 ~dVk~VaWSPd~~~~G-eIaA-SyDntIRVw~~d~-~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~  168 (2389)
                      .+|-.|.+++.   .+ .+|. +.|+.||+|.... ...+++-.=.-.++|. |+..|..|.|+|+|+.||||||+  +.
T Consensus        14 ~pv~s~dfq~n---~~~~laT~G~D~~iriW~v~r~~~~~~~~~V~y~s~Ls~H~~aVN~vRf~p~gelLASg~D~g~v~   90 (434)
T KOG1009|consen   14 EPVYSVDFQKN---SLNKLATAGGDKDIRIWKVNRSEPGGGDMKVEYLSSLSRHTRAVNVVRFSPDGELLASGGDGGEVF   90 (434)
T ss_pred             CceEEEEeccC---cccceecccCccceeeeeeeecCCCCCceeEEEeecccCCcceeEEEEEcCCcCeeeecCCCceEE
Confidence            69999999995   33 5663 4689999998762 2223321222244554 89999999999999999999998  88


Q ss_pred             Eeecc--------------CCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcc
Q 000080          169 LWKKK--------------NTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSE  233 (2389)
Q Consensus       169 IW~~~--------------~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~  233 (2389)
                      +|+..              ...|...=.+.+ |...+|+.+|+||+. +++++.|.            .+..|.. ....
T Consensus        91 lWk~~~~~~~~~d~e~~~~ke~w~v~k~lr~-h~~diydL~Ws~d~~~l~s~s~dn------------s~~l~Dv-~~G~  156 (434)
T KOG1009|consen   91 LWKQGDVRIFDADTEADLNKEKWVVKKVLRG-HRDDIYDLAWSPDSNFLVSGSVDN------------SVRLWDV-HAGQ  156 (434)
T ss_pred             EEEecCcCCccccchhhhCccceEEEEEecc-cccchhhhhccCCCceeeeeeccc------------eEEEEEe-ccce
Confidence            99965              344664322343 667899999999999 88888873            3444432 2333


Q ss_pred             ceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEE
Q 000080          234 YIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVR  280 (2389)
Q Consensus       234 ~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVR  280 (2389)
                      .......|...|++|+|-|-        .++     ++|=|-|.-.+
T Consensus       157 l~~~~~dh~~yvqgvawDpl--------~qy-----v~s~s~dr~~~  190 (434)
T KOG1009|consen  157 LLAILDDHEHYVQGVAWDPL--------NQY-----VASKSSDRHPE  190 (434)
T ss_pred             eEeeccccccccceeecchh--------hhh-----hhhhccCcccc
Confidence            56677899999999999993        233     56666776333


No 159
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.82  E-value=8.5e-09  Score=126.88  Aligned_cols=92  Identities=14%  Similarity=0.238  Sum_probs=79.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|...+|+|||++||+-|+||.+||+|+.+-+++..++..          -+...+|++||||+++|+|++|.-|.+|.+
T Consensus       292 ~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~eLlg~mkSY----------FGGLLCvcWSPDGKyIvtGGEDDLVtVwSf  361 (636)
T KOG2394|consen  292 SINEFAFSPDGKYLATVSQDGFLRIFDFDTQELLGVMKSY----------FGGLLCVCWSPDGKYIVTGGEDDLVTVWSF  361 (636)
T ss_pred             cccceeEcCCCceEEEEecCceEEEeeccHHHHHHHHHhh----------ccceEEEEEcCCccEEEecCCcceEEEEEe
Confidence            4466799999999999999999999999877766544321          155899999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEe
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYI 2327 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFS 2327 (2389)
                      ...     +.+..-+||..+|+.|||.
T Consensus       362 ~er-----RVVARGqGHkSWVs~VaFD  383 (636)
T KOG2394|consen  362 EER-----RVVARGQGHKSWVSVVAFD  383 (636)
T ss_pred             ccc-----eEEEeccccccceeeEeec
Confidence            864     5677789999999999998


No 160
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=98.82  E-value=7.3e-09  Score=123.22  Aligned_cols=114  Identities=18%  Similarity=0.297  Sum_probs=91.2

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .+.+|+|+|.+-.+++|++|..++.+|++.=+ .+..+          .+|.+.|.+|.|||-|+-|+|||-|.||||+.
T Consensus       231 RTN~IswnPeafnF~~a~ED~nlY~~DmR~l~~p~~v~----------~dhvsAV~dVdfsptG~EfvsgsyDksIRIf~  300 (433)
T KOG0268|consen  231 RTNTICWNPEAFNFVAANEDHNLYTYDMRNLSRPLNVH----------KDHVSAVMDVDFSPTGQEFVSGSYDKSIRIFP  300 (433)
T ss_pred             cccceecCccccceeeccccccceehhhhhhcccchhh----------cccceeEEEeccCCCcchhccccccceEEEee
Confidence            55678999999999999999999999996432 22322          26779999999999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      ++.+. |  +.++- .---..|.+|.||- |.++|.||   |+|++||||...
T Consensus       301 ~~~~~-S--RdiYh-tkRMq~V~~Vk~S~-Dskyi~SG---Sdd~nvRlWka~  345 (433)
T KOG0268|consen  301 VNHGH-S--RDIYH-TKRMQHVFCVKYSM-DSKYIISG---SDDGNVRLWKAK  345 (433)
T ss_pred             cCCCc-c--hhhhh-HhhhheeeEEEEec-cccEEEec---CCCcceeeeecc
Confidence            99762 2  22210 00114788999999 88999985   799999999963


No 161
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=98.81  E-value=5.2e-08  Score=115.05  Aligned_cols=155  Identities=16%  Similarity=0.420  Sum_probs=126.2

Q ss_pred             CeeEEEEcCCCCCCCcEEEec-CCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc--eEEee
Q 000080           96 PVTSISWSPETPSIGQLAAAS-ENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWK  171 (2389)
Q Consensus        96 dVk~VaWSPd~~~~GeIaASy-DntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~  171 (2389)
                      +++|-||++|   ...||.+. .+-|-||+-.     +..-|....+|. |...|..|.|+|.++||++|+-|  --+|.
T Consensus        12 pitchAwn~d---rt~iAv~~~~~evhiy~~~-----~~~~w~~~htls~Hd~~vtgvdWap~snrIvtcs~drnayVw~   83 (361)
T KOG1523|consen   12 PITCHAWNSD---RTQIAVSPNNHEVHIYSML-----GADLWEPAHTLSEHDKIVTGVDWAPKSNRIVTCSHDRNAYVWT   83 (361)
T ss_pred             ceeeeeecCC---CceEEeccCCceEEEEEec-----CCCCceeceehhhhCcceeEEeecCCCCceeEccCCCCccccc
Confidence            8999999999   77788775 4689999987     232499999996 89999999999999999999998  77999


Q ss_pred             c-cCCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCcccee---ecccCCCCee
Q 000080          172 K-KNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIK---LELCHPQPVS  246 (2389)
Q Consensus       172 ~-~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~---ve~aH~qdVn  246 (2389)
                      . ..++|+-.--+ ..+.+-.-+|.|||.+. ||++++...            +-|||+.++.....   +...|-..|.
T Consensus        84 ~~~~~~WkptlvL-lRiNrAAt~V~WsP~enkFAVgSgar~------------isVcy~E~ENdWWVsKhikkPirStv~  150 (361)
T KOG1523|consen   84 QPSGGTWKPTLVL-LRINRAATCVKWSPKENKFAVGSGARL------------ISVCYYEQENDWWVSKHIKKPIRSTVT  150 (361)
T ss_pred             cCCCCeeccceeE-EEeccceeeEeecCcCceEEeccCccE------------EEEEEEecccceehhhhhCCcccccee
Confidence            7 78899876544 35667777899999877 999999633            45777766665533   4577889999


Q ss_pred             EEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEe
Q 000080          247 MVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCE  284 (2389)
Q Consensus       247 ~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e  284 (2389)
                      ++.|+|             ..=+||.+|-|+-+|+..-
T Consensus       151 sldWhp-------------nnVLlaaGs~D~k~rVfSa  175 (361)
T KOG1523|consen  151 SLDWHP-------------NNVLLAAGSTDGKCRVFSA  175 (361)
T ss_pred             eeeccC-------------CcceecccccCcceeEEEE
Confidence            999999             3446899999999999973


No 162
>KOG0268 consensus Sof1-like rRNA processing protein (contains WD40 repeats) [RNA processing and modification]
Probab=98.80  E-value=7.2e-09  Score=123.27  Aligned_cols=162  Identities=14%  Similarity=0.132  Sum_probs=123.1

Q ss_pred             ccccccccc--cCCCCcCc--eeEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEE
Q 000080         2203 TQDDFEDYV--DPPATVEN--ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISAL 2277 (2389)
Q Consensus      2203 ~~~~~~~~~--d~~atv~n--i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sV 2277 (2389)
                      +...+|+..  .|+.+...  -.|.+|.|+|.-. +|++++.|++|.|+|.++++.++....           .-.-..|
T Consensus       167 e~i~IWD~~R~~Pv~smswG~Dti~svkfNpvETsILas~~sDrsIvLyD~R~~~Pl~KVi~-----------~mRTN~I  235 (433)
T KOG0268|consen  167 EQIDIWDEQRDNPVSSMSWGADSISSVKFNPVETSILASCASDRSIVLYDLRQASPLKKVIL-----------TMRTNTI  235 (433)
T ss_pred             ceeeecccccCCccceeecCCCceeEEecCCCcchheeeeccCCceEEEecccCCccceeee-----------eccccce
Confidence            445556553  44444332  2458999999866 788888999999999999988765421           1234789


Q ss_pred             EECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080         2278 QFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus      2278 aFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
                      +|+|.+--|.+|++|..+.+.|++.-    .+|+..+.+|...|.+|+||| .|+-++||   |-|++|||+.+...+..
T Consensus       236 swnPeafnF~~a~ED~nlY~~DmR~l----~~p~~v~~dhvsAV~dVdfsp-tG~Efvsg---syDksIRIf~~~~~~SR  307 (433)
T KOG0268|consen  236 CWNPEAFNFVAANEDHNLYTYDMRNL----SRPLNVHKDHVSAVMDVDFSP-TGQEFVSG---SYDKSIRIFPVNHGHSR  307 (433)
T ss_pred             ecCccccceeeccccccceehhhhhh----cccchhhcccceeEEEeccCC-Ccchhccc---cccceEEEeecCCCcch
Confidence            99999999999999999999999864    278889999999999999999 99999996   68999999998543333


Q ss_pred             ceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2358 SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2358 ~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      .+.- .--...|.||..|-|-.|++|-
T Consensus       308 diYh-tkRMq~V~~Vk~S~Dskyi~SG  333 (433)
T KOG0268|consen  308 DIYH-TKRMQHVFCVKYSMDSKYIISG  333 (433)
T ss_pred             hhhh-HhhhheeeEEEEeccccEEEec
Confidence            2210 0012347788888888888774


No 163
>KOG1036 consensus Mitotic spindle checkpoint protein BUB3, WD repeat superfamily [Cell cycle control, cell division, chromosome partitioning]
Probab=98.80  E-value=3.9e-08  Score=115.76  Aligned_cols=183  Identities=11%  Similarity=0.117  Sum_probs=134.7

Q ss_pred             CCccccCccccccccccccceeeccccccccccccccCCCCcC---ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc
Q 000080         2176 PGRDLTGGLAFGIPGYAGIGASALGWETQDDFEDYVDPPATVE---NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK 2252 (2389)
Q Consensus      2176 ~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~~~~~~~d~~atv~---ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk 2252 (2389)
                      ||++..--.-|+ +-...++|+-  ||..-++-++......+.   .-++-..+|.+ -..+++|+.||.||+.|+.++.
T Consensus        11 pP~d~IS~v~f~-~~~~~LLvss--WDgslrlYdv~~~~l~~~~~~~~plL~c~F~d-~~~~~~G~~dg~vr~~Dln~~~   86 (323)
T KOG1036|consen   11 PPEDGISSVKFS-PSSSDLLVSS--WDGSLRLYDVPANSLKLKFKHGAPLLDCAFAD-ESTIVTGGLDGQVRRYDLNTGN   86 (323)
T ss_pred             CChhceeeEEEc-CcCCcEEEEe--ccCcEEEEeccchhhhhheecCCceeeeeccC-CceEEEeccCceEEEEEecCCc
Confidence            444443334566 6666677765  999999887742222211   24678899999 4568889999999999998887


Q ss_pred             eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC---------Cc------------------
Q 000080         2253 ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVG---------GR------------------ 2305 (2389)
Q Consensus      2253 ~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg---------gr------------------ 2305 (2389)
                      .....           -|...|++|.+++--..+.|||+|++|++||.+..         ++                  
T Consensus        87 ~~~ig-----------th~~~i~ci~~~~~~~~vIsgsWD~~ik~wD~R~~~~~~~~d~~kkVy~~~v~g~~LvVg~~~r  155 (323)
T KOG1036|consen   87 EDQIG-----------THDEGIRCIEYSYEVGCVISGSWDKTIKFWDPRNKVVVGTFDQGKKVYCMDVSGNRLVVGTSDR  155 (323)
T ss_pred             ceeec-----------cCCCceEEEEeeccCCeEEEcccCccEEEEeccccccccccccCceEEEEeccCCEEEEeecCc
Confidence            54432           25688999999999999999999999999999831         00                  


Q ss_pred             -----------------------------------------------------c--CcccceeeeecC---------CCe
Q 000080         2306 -----------------------------------------------------S--NVRPMESCLCFS---------SHA 2321 (2389)
Q Consensus      2306 -----------------------------------------------------s--~~k~l~tl~gHs---------~~V 2321 (2389)
                                                                           +  ....-+.+.||.         .+|
T Consensus       156 ~v~iyDLRn~~~~~q~reS~lkyqtR~v~~~pn~eGy~~sSieGRVavE~~d~s~~~~skkyaFkCHr~~~~~~~~~yPV  235 (323)
T KOG1036|consen  156 KVLIYDLRNLDEPFQRRESSLKYQTRCVALVPNGEGYVVSSIEGRVAVEYFDDSEEAQSKKYAFKCHRLSEKDTEIIYPV  235 (323)
T ss_pred             eEEEEEcccccchhhhccccceeEEEEEEEecCCCceEEEeecceEEEEccCCchHHhhhceeEEeeecccCCceEEEEe
Confidence                                                                 0  001123345554         478


Q ss_pred             eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2322 MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2322 ~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      ++++|+| --..+||||   .||-|-+||.  .+.+.+..|..-++.|.++|++-+|-
T Consensus       236 Nai~Fhp-~~~tfaTgG---sDG~V~~Wd~--~~rKrl~q~~~~~~SI~slsfs~dG~  287 (323)
T KOG1036|consen  236 NAIAFHP-IHGTFATGG---SDGIVNIWDL--FNRKRLKQLAKYETSISSLSFSMDGS  287 (323)
T ss_pred             ceeEecc-ccceEEecC---CCceEEEccC--cchhhhhhccCCCCceEEEEeccCCC
Confidence            9999999 457799986   8999999998  46677888888888899999998884


No 164
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=98.80  E-value=5e-08  Score=111.81  Aligned_cols=152  Identities=14%  Similarity=0.178  Sum_probs=105.5

Q ss_pred             eeeccccccc------cccccccCCCC--cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCC
Q 000080         2196 ASALGWETQD------DFEDYVDPPAT--VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPP 2267 (2389)
Q Consensus      2196 Asg~~~d~~~------~~~~~~d~~at--v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~ 2267 (2389)
                      ..|.-|++-+      ++|+...|-++  ++-..|.++...|..+-|+.++.|+.++.||+++|+..++|+         
T Consensus        83 V~gw~W~E~~es~~~K~lwe~~~P~~~~~~evPeINam~ldP~enSi~~AgGD~~~y~~dlE~G~i~r~~r---------  153 (325)
T KOG0649|consen   83 VYGWEWNEEEESLATKRLWEVKIPMQVDAVEVPEINAMWLDPSENSILFAGGDGVIYQVDLEDGRIQREYR---------  153 (325)
T ss_pred             EEEeeehhhhhhccchhhhhhcCccccCcccCCccceeEeccCCCcEEEecCCeEEEEEEecCCEEEEEEc---------
Confidence            4455565544      46665444333  233466999999988877788899999999999999999996         


Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee------eec-CCCeeEEEEecCCCCEEEEeecC
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC------LCF-SSHAMDVSYITSSGSVIAAAGHS 2340 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl------~gH-s~~V~sVAFSP~DGslLASAG~s 2340 (2389)
                       ||+++|.+|+--.-.-.+.||++|||||+||++|+.  +.+.+...      +.| ..+|-+++-+.   .+|++|   
T Consensus       154 -GHtDYvH~vv~R~~~~qilsG~EDGtvRvWd~kt~k--~v~~ie~yk~~~~lRp~~g~wigala~~e---dWlvCG---  224 (325)
T KOG0649|consen  154 -GHTDYVHSVVGRNANGQILSGAEDGTVRVWDTKTQK--HVSMIEPYKNPNLLRPDWGKWIGALAVNE---DWLVCG---  224 (325)
T ss_pred             -CCcceeeeeeecccCcceeecCCCccEEEEeccccc--eeEEeccccChhhcCcccCceeEEEeccC---ceEEec---
Confidence             688999999994444468899999999999999973  22222211      112 24555666554   789886   


Q ss_pred             CCCCeEEEeeCCCCCCCceEEEEeec
Q 000080         2341 SNGINVVVWDTLAPPTSSRASITCHE 2366 (2389)
Q Consensus      2341 S~D~TVrLWD~l~~tg~~v~sL~GH~ 2366 (2389)
                       .+...-||.+...+..|+-.+.+|.
T Consensus       225 -gGp~lslwhLrsse~t~vfpipa~v  249 (325)
T KOG0649|consen  225 -GGPKLSLWHLRSSESTCVFPIPARV  249 (325)
T ss_pred             -CCCceeEEeccCCCceEEEecccce
Confidence             4678999998544434444445443


No 165
>PRK01742 tolB translocation protein TolB; Provisional
Probab=98.79  E-value=2.8e-08  Score=123.62  Aligned_cols=139  Identities=12%  Similarity=0.032  Sum_probs=98.1

Q ss_pred             eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTVC 2296 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTVk 2296 (2389)
                      .+.+.+|||||+.||.+|.+   .+|++||+.+|+.... ..++       ||   ..+++|||||++||.++ .||.++
T Consensus       205 ~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~~~l-~~~~-------g~---~~~~~wSPDG~~La~~~~~~g~~~  273 (429)
T PRK01742        205 PLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGARKVV-ASFR-------GH---NGAPAFSPDGSRLAFASSKDGVLN  273 (429)
T ss_pred             ccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCceEEE-ecCC-------Cc---cCceeECCCCCEEEEEEecCCcEE
Confidence            45788999999999998754   4799999988864322 1112       22   34689999999999875 688877


Q ss_pred             Ee--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2297 TW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2297 LW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      ||  |+.++      ....+..|...+.+.+|+| ||+.|+.++  ..++.++||++... +.....+ +|.+  .+.++
T Consensus       274 Iy~~d~~~~------~~~~lt~~~~~~~~~~wSp-DG~~i~f~s--~~~g~~~I~~~~~~-~~~~~~l-~~~~--~~~~~  340 (429)
T PRK01742        274 IYVMGANGG------TPSQLTSGAGNNTEPSWSP-DGQSILFTS--DRSGSPQVYRMSAS-GGGASLV-GGRG--YSAQI  340 (429)
T ss_pred             EEEEECCCC------CeEeeccCCCCcCCEEECC-CCCEEEEEE--CCCCCceEEEEECC-CCCeEEe-cCCC--CCccC
Confidence            76  55543      2345566777788999999 999888753  46788999997422 2333333 4544  46788


Q ss_pred             cccchhhhc
Q 000080         2375 LKLLNFALS 2383 (2389)
Q Consensus      2375 ~~~~~~~~s 2383 (2389)
                      +|+|++++.
T Consensus       341 SpDG~~ia~  349 (429)
T PRK01742        341 SADGKTLVM  349 (429)
T ss_pred             CCCCCEEEE
Confidence            999988653


No 166
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.79  E-value=2.7e-09  Score=135.23  Aligned_cols=109  Identities=16%  Similarity=0.291  Sum_probs=99.1

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|.++.|...|.++++||+|..||+|-..++.|+.+.+          ||.+.++.++-+...-++|++|.|..||+|-+
T Consensus       192 aVyca~fDrtg~~Iitgsdd~lvKiwS~et~~~lAs~r----------Ghs~ditdlavs~~n~~iaaaS~D~vIrvWrl  261 (1113)
T KOG0644|consen  192 AVYCAIFDRTGRYIITGSDDRLVKIWSMETARCLASCR----------GHSGDITDLAVSSNNTMIAAASNDKVIRVWRL  261 (1113)
T ss_pred             heeeeeeccccceEeecCccceeeeeeccchhhhccCC----------CCccccchhccchhhhhhhhcccCceEEEEec
Confidence            35899999999999999999999999999999998874          68899999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .++     .|+.-++||++.|++++|+|     .+++   ++|+|+++||..
T Consensus       262 ~~~-----~pvsvLrghtgavtaiafsP-----~~ss---s~dgt~~~wd~r  300 (1113)
T KOG0644|consen  262 PDG-----APVSVLRGHTGAVTAIAFSP-----RASS---SDDGTCRIWDAR  300 (1113)
T ss_pred             CCC-----chHHHHhccccceeeeccCc-----cccC---CCCCceEecccc
Confidence            987     47888999999999999999     3343   699999999973


No 167
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=98.76  E-value=7.3e-08  Score=113.41  Aligned_cols=155  Identities=14%  Similarity=0.210  Sum_probs=112.5

Q ss_pred             CCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080         2215 ATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus      2215 atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
                      .|+++....++.|++.|.+||.|-.||.|-|||+.|-..-+++          .+|...|+++++|+||++|.|+|.|..
T Consensus        19 ~tld~~~a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~~iar~l----------saH~~pi~sl~WS~dgr~LltsS~D~s   88 (405)
T KOG1273|consen   19 HTLDNPLAECCQFSRWGDYLAVGCANGRVVIYDFDTFRIARML----------SAHVRPITSLCWSRDGRKLLTSSRDWS   88 (405)
T ss_pred             eeccCCccceEEeccCcceeeeeccCCcEEEEEccccchhhhh----------hccccceeEEEecCCCCEeeeecCCce
Confidence            3455555678899999999999999999999999866644444          257788999999999999999999999


Q ss_pred             EEEeeCCCCCcc----CcccceeeeecCCC-------------------------------------eeEEEEecCCCCE
Q 000080         2295 VCTWQLEVGGRS----NVRPMESCLCFSSH-------------------------------------AMDVSYITSSGSV 2333 (2389)
Q Consensus      2295 VkLWDl~tggrs----~~k~l~tl~gHs~~-------------------------------------V~sVAFSP~DGsl 2333 (2389)
                      |++||+..|..-    -..|+...+-|...                                     .....|.+ .|++
T Consensus        89 i~lwDl~~gs~l~rirf~spv~~~q~hp~k~n~~va~~~~~sp~vi~~s~~~h~~Lp~d~d~dln~sas~~~fdr-~g~y  167 (405)
T KOG1273|consen   89 IKLWDLLKGSPLKRIRFDSPVWGAQWHPRKRNKCVATIMEESPVVIDFSDPKHSVLPKDDDGDLNSSASHGVFDR-RGKY  167 (405)
T ss_pred             eEEEeccCCCceeEEEccCccceeeeccccCCeEEEEEecCCcEEEEecCCceeeccCCCccccccccccccccC-CCCE
Confidence            999999887310    00011111111110                                     01122555 6888


Q ss_pred             EEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-CcEEEEeecccchhhhccc
Q 000080         2334 IAAAGHSSNGINVVVWDTLAPPTSSRASITCHE-GLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2334 LASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~-~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      |.+|   ..-|.+-+.|.  .+-+|++++.--+ ..|..+-++-.|+|.+-.|
T Consensus       168 IitG---tsKGkllv~~a--~t~e~vas~rits~~~IK~I~~s~~g~~liiNt  215 (405)
T KOG1273|consen  168 IITG---TSKGKLLVYDA--ETLECVASFRITSVQAIKQIIVSRKGRFLIINT  215 (405)
T ss_pred             EEEe---cCcceEEEEec--chheeeeeeeechheeeeEEEEeccCcEEEEec
Confidence            8874   46778888886  5668888886555 7788899999999887655


No 168
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.71  E-value=1.8e-07  Score=116.54  Aligned_cols=141  Identities=18%  Similarity=0.130  Sum_probs=101.2

Q ss_pred             eEEEEEEcCCCCeEEEEeC---CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCc--
Q 000080         2221 STRAFSSHPLRPFFLVGSS---NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGT-- 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~---DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgT-- 2294 (2389)
                      .+.+.+|+|||+.|+..+.   +.+|++||+.+|+... +.   .       +.+.+.+.+|||||+.|| +.+.|+.  
T Consensus       203 ~v~~p~wSpDG~~lay~s~~~g~~~i~~~dl~~g~~~~-l~---~-------~~g~~~~~~~SPDG~~la~~~~~~g~~~  271 (435)
T PRK05137        203 LVLTPRFSPNRQEITYMSYANGRPRVYLLDLETGQREL-VG---N-------FPGMTFAPRFSPDGRKVVMSLSQGGNTD  271 (435)
T ss_pred             CeEeeEECCCCCEEEEEEecCCCCEEEEEECCCCcEEE-ee---c-------CCCcccCcEECCCCCEEEEEEecCCCce
Confidence            4588899999999988774   5789999998887532 21   1       124567889999999876 5566666  


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      |.+||++++.      ...+..|.....+.+|+| ||+.||.++....+..|.+||+   .+..++.+..+.+.+...+.
T Consensus       272 Iy~~d~~~~~------~~~Lt~~~~~~~~~~~sp-DG~~i~f~s~~~g~~~Iy~~d~---~g~~~~~lt~~~~~~~~~~~  341 (435)
T PRK05137        272 IYTMDLRSGT------TTRLTDSPAIDTSPSYSP-DGSQIVFESDRSGSPQLYVMNA---DGSNPRRISFGGGRYSTPVW  341 (435)
T ss_pred             EEEEECCCCc------eEEccCCCCccCceeEcC-CCCEEEEEECCCCCCeEEEEEC---CCCCeEEeecCCCcccCeEE
Confidence            6666887652      344555666677899999 9999987631112235777775   34556677666677778889


Q ss_pred             cccchhhh
Q 000080         2375 LKLLNFAL 2382 (2389)
Q Consensus      2375 ~~~~~~~~ 2382 (2389)
                      +|+|++++
T Consensus       342 SpdG~~ia  349 (435)
T PRK05137        342 SPRGDLIA  349 (435)
T ss_pred             CCCCCEEE
Confidence            99999875


No 169
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=98.71  E-value=1.6e-07  Score=116.94  Aligned_cols=144  Identities=15%  Similarity=0.177  Sum_probs=103.4

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LASgS~DgTVkLW 2298 (2389)
                      .||+|+.+|.|.+|||||+|||||||++.+|+|+++.+.           .+.|++|+|+|.++  .||.|-+ +.+-|-
T Consensus       402 ~Vr~iSvdp~G~wlasGsdDGtvriWEi~TgRcvr~~~~-----------d~~I~~vaw~P~~~~~vLAvA~~-~~~~iv  469 (733)
T KOG0650|consen  402 LVRSISVDPSGEWLASGSDDGTVRIWEIATGRCVRTVQF-----------DSEIRSVAWNPLSDLCVLAVAVG-ECVLIV  469 (733)
T ss_pred             eEEEEEecCCcceeeecCCCCcEEEEEeecceEEEEEee-----------cceeEEEEecCCCCceeEEEEec-CceEEe
Confidence            689999999999999999999999999999999999852           25699999999985  4444444 335555


Q ss_pred             eCCCCCc--------------------------------cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2299 QLEVGGR--------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2299 Dl~tggr--------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      |..-|.+                                +..+-+.....|.+.|++|.|+. .|.+|||.-..+..+.|
T Consensus       470 np~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~~v~~~I~~~k~i~~vtWHr-kGDYlatV~~~~~~~~V  548 (733)
T KOG0650|consen  470 NPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEKGVCIVIKHPKSIRQVTWHR-KGDYLATVMPDSGNKSV  548 (733)
T ss_pred             CccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhccceEEEEecCCccceeeeec-CCceEEEeccCCCcceE
Confidence            4433311                                00111234456889999999999 99999998655566789


Q ss_pred             EEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      -|.++-.  ....-.|.--.+-|.++.|+|.--
T Consensus       549 liHQLSK--~~sQ~PF~kskG~vq~v~FHPs~p  579 (733)
T KOG0650|consen  549 LIHQLSK--RKSQSPFRKSKGLVQRVKFHPSKP  579 (733)
T ss_pred             EEEeccc--ccccCchhhcCCceeEEEecCCCc
Confidence            9999832  222234444556677788877643


No 170
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.65  E-value=1.2e-07  Score=112.85  Aligned_cols=139  Identities=15%  Similarity=0.212  Sum_probs=106.8

Q ss_pred             ceeeccccccccccccccCCCCcCceeEEEEEEcC--CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCC
Q 000080         2195 GASALGWETQDDFEDYVDPPATVENISTRAFSSHP--LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALA 2272 (2389)
Q Consensus      2195 ~Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsP--dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~ 2272 (2389)
                      ..+-+.|++...++.|.-++++++.+     .|..  .+..+.||+.||+||+||++.......+. ..++  |    ..
T Consensus        51 sv~lyd~~tg~~l~~fk~~~~~~N~v-----rf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e~a~~~-~~~~--~----~~  118 (376)
T KOG1188|consen   51 SVRLYDKGTGQLLEEFKGPPATTNGV-----RFISCDSPHGVISCSSDGTVRLWDIRSQAESARIS-WTQQ--S----GT  118 (376)
T ss_pred             eEEEEeccchhhhheecCCCCcccce-----EEecCCCCCeeEEeccCCeEEEEEeecchhhhhee-ccCC--C----CC
Confidence            34568899999999999999998765     3433  34469999999999999998765443332 1222  1    14


Q ss_pred             CEEEEEECCCCCEEEEEe----CCCcEEEeeCCCCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2273 SISALQFDHYGHRFASAA----LDGTVCTWQLEVGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2273 ~V~sVaFSPDG~~LASgS----~DgTVkLWDl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                      .-.+++.+-.++.+|.|.    .|-.|.+||++...    +++.. ...|...|+.|.|+|.+-++|+||   |-||.|.
T Consensus       119 ~f~~ld~nck~~ii~~GtE~~~s~A~v~lwDvR~~q----q~l~~~~eSH~DDVT~lrFHP~~pnlLlSG---SvDGLvn  191 (376)
T KOG1188|consen  119 PFICLDLNCKKNIIACGTELTRSDASVVLWDVRSEQ----QLLRQLNESHNDDVTQLRFHPSDPNLLLSG---SVDGLVN  191 (376)
T ss_pred             cceEeeccCcCCeEEeccccccCceEEEEEEecccc----chhhhhhhhccCcceeEEecCCCCCeEEee---cccceEE
Confidence            567888888999999987    47889999999742    33433 355999999999999999999996   7999999


Q ss_pred             EeeCC
Q 000080         2348 VWDTL 2352 (2389)
Q Consensus      2348 LWD~l 2352 (2389)
                      |.|+.
T Consensus       192 lfD~~  196 (376)
T KOG1188|consen  192 LFDTK  196 (376)
T ss_pred             eeecC
Confidence            99984


No 171
>KOG0650 consensus WD40 repeat nucleolar protein Bop1, involved in ribosome biogenesis [Translation, ribosomal structure and biogenesis]
Probab=98.65  E-value=7e-07  Score=111.44  Aligned_cols=235  Identities=17%  Similarity=0.290  Sum_probs=142.0

Q ss_pred             CCCC---CCCCcccc------cccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccccccccee
Q 000080           16 CVDP---TEHLPLAF------LRSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQ   86 (2389)
Q Consensus        16 ~~~~---~~~lpl~~------~~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Q   86 (2389)
                      -+||   ||.||-+-      ..-.++=-+|+--+++|+-.|.  | +|+|-|+..+.|-.|  .=.++ .++      -
T Consensus       369 niDpe~LiPkLPsp~dLrPFPt~~~lvyrGHtg~Vr~iSvdp~--G-~wlasGsdDGtvriW--Ei~Tg-Rcv------r  436 (733)
T KOG0650|consen  369 NIDPESLIPKLPSPKDLRPFPTRCALVYRGHTGLVRSISVDPS--G-EWLASGSDDGTVRIW--EIATG-RCV------R  436 (733)
T ss_pred             cCCHHHhcccCCChhhcCCCcceeeeeEeccCCeEEEEEecCC--c-ceeeecCCCCcEEEE--Eeecc-eEE------E
Confidence            3554   77777543      2334455678888899988774  8 699999999999999  32222 233      2


Q ss_pred             eeeccCCCCCeeEEEEcCCCCCCCcEEEecCCeEEEEeeC-C-------------------CCCCCCccceee-------
Q 000080           87 VFALSDNSLPVTSISWSPETPSIGQLAAASENCIFVFAHD-S-------------------ASSKGSFCWSQN-------  139 (2389)
Q Consensus        87 viegh~d~~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d-~-------------------~~~kgd~~W~~~-------  139 (2389)
                      .++.-   ..|.||+|+|. +...-|||++++++-|-.+. .                   ..+..-..|...       
T Consensus       437 ~~~~d---~~I~~vaw~P~-~~~~vLAvA~~~~~~ivnp~~G~~~e~~~t~ell~~~~~~~~p~~~~~~W~~~~~~e~~~  512 (733)
T KOG0650|consen  437 TVQFD---SEIRSVAWNPL-SDLCVLAVAVGECVLIVNPIFGDRLEVGPTKELLASAPNESEPDAAVVTWSRASLDELEK  512 (733)
T ss_pred             EEeec---ceeEEEEecCC-CCceeEEEEecCceEEeCccccchhhhcchhhhhhcCCCccCCcccceeechhhhhhhcc
Confidence            22222   25999999995 44445667888776555431 0                   000111256543       


Q ss_pred             ---EEecccceEEEEeecCCCCeEEEEecc-----eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec-cc
Q 000080          140 ---AILVQGTKVEAIEWTGSGDGIVAGGME-----TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS-MS  209 (2389)
Q Consensus       140 ---~tL~hssTV~sIAWSpdG~rLaSggdD-----V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~-di  209 (2389)
                         .++.|..+|+.|.|...|+||+++.-+     |.|.|.....=++-+.   .....+..+.+-|.-. |..|++ .+
T Consensus       513 ~v~~~I~~~k~i~~vtWHrkGDYlatV~~~~~~~~VliHQLSK~~sQ~PF~---kskG~vq~v~FHPs~p~lfVaTq~~v  589 (733)
T KOG0650|consen  513 GVCIVIKHPKSIRQVTWHRKGDYLATVMPDSGNKSVLIHQLSKRKSQSPFR---KSKGLVQRVKFHPSKPYLFVATQRSV  589 (733)
T ss_pred             ceEEEEecCCccceeeeecCCceEEEeccCCCcceEEEEecccccccCchh---hcCCceeEEEecCCCceEEEEeccce
Confidence               556688999999999999999966653     7788854433333321   1223455667777655 333333 33


Q ss_pred             c-cccC----------C---------CCCCCceeEEEeeCCCc---------cceeecccCCCCeeEEEeccCCCCCCCC
Q 000080          210 Q-LDLL----------G---------PKEAGKCVFICCSDGKS---------EYIKLELCHPQPVSMVQWRPSTRRHSPG  260 (2389)
Q Consensus       210 k-f~~~----------~---------~~~~~kpV~V~~~dg~~---------~~~~ve~aH~qdVn~V~W~Ps~~~~~~~  260 (2389)
                      + |...          +         .+..++ +.+.-+|.+.         --......|...|..|+.||        
T Consensus       590 RiYdL~kqelvKkL~tg~kwiS~msihp~GDn-li~gs~d~k~~WfDldlsskPyk~lr~H~~avr~Va~H~--------  660 (733)
T KOG0650|consen  590 RIYDLSKQELVKKLLTGSKWISSMSIHPNGDN-LILGSYDKKMCWFDLDLSSKPYKTLRLHEKAVRSVAFHK--------  660 (733)
T ss_pred             EEEehhHHHHHHHHhcCCeeeeeeeecCCCCe-EEEecCCCeeEEEEcccCcchhHHhhhhhhhhhhhhhcc--------
Confidence            3 1110          0         011111 1111112111         01123467999999999999        


Q ss_pred             CCccccCceEEeeecCCeEEEEE
Q 000080          261 DTKRSQRHVLLTCCLDGTVRLWC  283 (2389)
Q Consensus       261 Dgk~~~~nILAScSdDgTVRLW~  283 (2389)
                           .-.+++|||+||||-|.-
T Consensus       661 -----ryPLfas~sdDgtv~Vfh  678 (733)
T KOG0650|consen  661 -----RYPLFASGSDDGTVIVFH  678 (733)
T ss_pred             -----ccceeeeecCCCcEEEEe
Confidence                 357899999999998876


No 172
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=98.62  E-value=5.8e-07  Score=107.23  Aligned_cols=154  Identities=12%  Similarity=0.076  Sum_probs=99.0

Q ss_pred             EEEEEEcCCCCeE-EEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEee
Q 000080         2222 TRAFSSHPLRPFF-LVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQ 2299 (2389)
Q Consensus      2222 VrsVAFsPdG~~L-ASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWD 2299 (2389)
                      ...++|+|+|+++ ++...+++|++||+.+...+........ ..+ .|  ...+.++|+|||+++.++.. +++|.+||
T Consensus       128 ~~~~~~~p~g~~l~v~~~~~~~v~v~d~~~~g~l~~~~~~~~-~~~-~g--~~p~~~~~~pdg~~lyv~~~~~~~v~v~~  203 (330)
T PRK11028        128 CHSANIDPDNRTLWVPCLKEDRIRLFTLSDDGHLVAQEPAEV-TTV-EG--AGPRHMVFHPNQQYAYCVNELNSSVDVWQ  203 (330)
T ss_pred             ccEeEeCCCCCEEEEeeCCCCEEEEEEECCCCcccccCCCce-ecC-CC--CCCceEEECCCCCEEEEEecCCCEEEEEE
Confidence            3677999999987 5566779999999976432211000000 001 12  33578999999999988876 99999999


Q ss_pred             CCCCCccCcccceeeeec------CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC---cEE
Q 000080         2300 LEVGGRSNVRPMESCLCF------SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG---LYD 2370 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gH------s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~---~V~ 2370 (2389)
                      ++.++. ..+.+.++..+      .....+++|+| ||++|.++.  ..+++|.+||+.  +......+.+|..   ..+
T Consensus       204 ~~~~~~-~~~~~~~~~~~p~~~~~~~~~~~i~~~p-dg~~lyv~~--~~~~~I~v~~i~--~~~~~~~~~~~~~~~~~p~  277 (330)
T PRK11028        204 LKDPHG-EIECVQTLDMMPADFSDTRWAADIHITP-DGRHLYACD--RTASLISVFSVS--EDGSVLSFEGHQPTETQPR  277 (330)
T ss_pred             EeCCCC-CEEEEEEEecCCCcCCCCccceeEEECC-CCCEEEEec--CCCCeEEEEEEe--CCCCeEEEeEEEeccccCC
Confidence            974210 11233333222      22344689999 999988863  467899999983  2222233444422   456


Q ss_pred             EEeecccchhhhccc
Q 000080         2371 LFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2371 svA~~~~~~~~~s~~ 2385 (2389)
                      .++++|+|+|+..-+
T Consensus       278 ~~~~~~dg~~l~va~  292 (330)
T PRK11028        278 GFNIDHSGKYLIAAG  292 (330)
T ss_pred             ceEECCCCCEEEEEE
Confidence            889999999987544


No 173
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.61  E-value=3.8e-08  Score=113.84  Aligned_cols=76  Identities=18%  Similarity=0.291  Sum_probs=69.7

Q ss_pred             CCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080         2215 ATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus      2215 atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
                      .+++|.+|..|..-||++++||++.|+.||++.+++.+.+..++          +|.+.|.+|+|+||-..+|+||.|++
T Consensus       247 ~~lknpGv~gvrIRpD~KIlATAGWD~RiRVyswrtl~pLAVLk----------yHsagvn~vAfspd~~lmAaaskD~r  316 (323)
T KOG0322|consen  247 ITLKNPGVSGVRIRPDGKILATAGWDHRIRVYSWRTLNPLAVLK----------YHSAGVNAVAFSPDCELMAAASKDAR  316 (323)
T ss_pred             EEecCCCccceEEccCCcEEeecccCCcEEEEEeccCCchhhhh----------hhhcceeEEEeCCCCchhhhccCCce
Confidence            55667777888999999999999999999999999999888774          68899999999999999999999999


Q ss_pred             EEEeeC
Q 000080         2295 VCTWQL 2300 (2389)
Q Consensus      2295 VkLWDl 2300 (2389)
                      |.||++
T Consensus       317 ISLWkL  322 (323)
T KOG0322|consen  317 ISLWKL  322 (323)
T ss_pred             EEeeec
Confidence            999986


No 174
>KOG0290 consensus Conserved WD40 repeat-containing protein AN11 [Function unknown]
Probab=98.61  E-value=1.7e-07  Score=109.61  Aligned_cols=120  Identities=18%  Similarity=0.255  Sum_probs=98.3

Q ss_pred             eEEEEEEcC-CCCeEEEEeCCCcEEEeecCCCce--eeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080         2221 STRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKA--TATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus      2221 ~VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
                      ++.+..|+- |-++|.+.|-|+|..+||+++|..  ++|-  +       ..|...|..|+|.-+| +.|||.+.||.||
T Consensus       152 PlTSFDWne~dp~~igtSSiDTTCTiWdie~~~~~~vkTQ--L-------IAHDKEV~DIaf~~~s~~~FASvgaDGSvR  222 (364)
T KOG0290|consen  152 PLTSFDWNEVDPNLIGTSSIDTTCTIWDIETGVSGTVKTQ--L-------IAHDKEVYDIAFLKGSRDVFASVGADGSVR  222 (364)
T ss_pred             cccccccccCCcceeEeecccCeEEEEEEeeccccceeeE--E-------EecCcceeEEEeccCccceEEEecCCCcEE
Confidence            557777776 455899999999999999999843  4442  1       2467999999999987 7999999999999


Q ss_pred             EeeCCCCCc-------------------------------------------cCcccceeeeecCCCeeEEEEecCCCCE
Q 000080         2297 TWQLEVGGR-------------------------------------------SNVRPMESCLCFSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus      2297 LWDl~tggr-------------------------------------------s~~k~l~tl~gHs~~V~sVAFSP~DGsl 2333 (2389)
                      +.|++.-..                                           .--.|+..+++|.+.|+.++|.|.++..
T Consensus       223 mFDLR~leHSTIIYE~p~~~~pLlRLswnkqDpnymATf~~dS~~V~iLDiR~P~tpva~L~~H~a~VNgIaWaPhS~~h  302 (364)
T KOG0290|consen  223 MFDLRSLEHSTIIYEDPSPSTPLLRLSWNKQDPNYMATFAMDSNKVVILDIRVPCTPVARLRNHQASVNGIAWAPHSSSH  302 (364)
T ss_pred             EEEecccccceEEecCCCCCCcceeeccCcCCchHHhhhhcCCceEEEEEecCCCcceehhhcCcccccceEecCCCCce
Confidence            999976321                                           0113567789999999999999999999


Q ss_pred             EEEeecCCCCCeEEEeeCC
Q 000080         2334 IAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2334 LASAG~sS~D~TVrLWD~l 2352 (2389)
                      |+|+|   +|..+-|||+-
T Consensus       303 ictaG---DD~qaliWDl~  318 (364)
T KOG0290|consen  303 ICTAG---DDCQALIWDLQ  318 (364)
T ss_pred             eeecC---CcceEEEEecc
Confidence            99986   99999999984


No 175
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=98.61  E-value=3.6e-08  Score=120.16  Aligned_cols=143  Identities=15%  Similarity=0.177  Sum_probs=122.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ++|..+.|=|.--+|+++|..|-++-=|+.+|+.+..++.         | .+.+..+.=+|-.-.+-.|-..|||.||.
T Consensus       210 ~~v~rLeFLPyHfLL~~~~~~G~L~Y~DVS~GklVa~~~t---------~-~G~~~vm~qNP~NaVih~GhsnGtVSlWS  279 (545)
T KOG1272|consen  210 IRVARLEFLPYHFLLVAASEAGFLKYQDVSTGKLVASIRT---------G-AGRTDVMKQNPYNAVIHLGHSNGTVSLWS  279 (545)
T ss_pred             CchhhhcccchhheeeecccCCceEEEeechhhhhHHHHc---------c-CCccchhhcCCccceEEEcCCCceEEecC
Confidence            5788999999999999999999999999999999877751         1 26688889999999999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccch
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      .+..     .|+..+.||.+.|++||+.+ +|+++||+|   .|+.|+|||+.  .-..++++.- ..++..+++|-.|.
T Consensus       280 P~sk-----ePLvKiLcH~g~V~siAv~~-~G~YMaTtG---~Dr~~kIWDlR--~~~ql~t~~t-p~~a~~ls~Sqkgl  347 (545)
T KOG1272|consen  280 PNSK-----EPLVKILCHRGPVSSIAVDR-GGRYMATTG---LDRKVKIWDLR--NFYQLHTYRT-PHPASNLSLSQKGL  347 (545)
T ss_pred             CCCc-----chHHHHHhcCCCcceEEECC-CCcEEeecc---cccceeEeeec--cccccceeec-CCCccccccccccc
Confidence            8874     58888999999999999999 999999986   89999999984  2334555554 56788999999999


Q ss_pred             hhhcc
Q 000080         2380 FALSK 2384 (2389)
Q Consensus      2380 ~~~s~ 2384 (2389)
                      -|||-
T Consensus       348 LA~~~  352 (545)
T KOG1272|consen  348 LALSY  352 (545)
T ss_pred             eeeec
Confidence            88874


No 176
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=98.61  E-value=1.4e-07  Score=115.07  Aligned_cols=149  Identities=11%  Similarity=0.153  Sum_probs=114.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|++++|+.||+.|++.+.+|.|.+||+++..+++++.. .|.        -.=++++.|++|.+||+||.-|-|-|+|.
T Consensus       346 ~v~~~~fsSdsk~l~~~~~~GeV~v~nl~~~~~~~rf~D-~G~--------v~gts~~~S~ng~ylA~GS~~GiVNIYd~  416 (514)
T KOG2055|consen  346 VVSDFTFSSDSKELLASGGTGEVYVWNLRQNSCLHRFVD-DGS--------VHGTSLCISLNGSYLATGSDSGIVNIYDG  416 (514)
T ss_pred             EEeeEEEecCCcEEEEEcCCceEEEEecCCcceEEEEee-cCc--------cceeeeeecCCCceEEeccCcceEEEecc
Confidence            479999999999999999999999999999999999852 221        12378899999999999999999999996


Q ss_pred             CCCC-ccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE---EeecCcEEEEeecc
Q 000080         2301 EVGG-RSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI---TCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2301 ~tgg-rs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL---~GH~~~V~svA~~~ 2376 (2389)
                      ++-- -.+++|+.++..-...|++++|+| |+++||-++ ...++++||=-+  |.-+....+   ..--+-|+|+||+|
T Consensus       417 ~s~~~s~~PkPik~~dNLtt~Itsl~Fn~-d~qiLAiaS-~~~knalrLVHv--PS~TVFsNfP~~n~~vg~vtc~aFSP  492 (514)
T KOG2055|consen  417 NSCFASTNPKPIKTVDNLTTAITSLQFNH-DAQILAIAS-RVKKNALRLVHV--PSCTVFSNFPTSNTKVGHVTCMAFSP  492 (514)
T ss_pred             chhhccCCCCchhhhhhhheeeeeeeeCc-chhhhhhhh-hccccceEEEec--cceeeeccCCCCCCcccceEEEEecC
Confidence            6520 026789999999999999999999 999999874 237788999776  211111111   22335589999999


Q ss_pred             -cchhhh
Q 000080         2377 -LLNFAL 2382 (2389)
Q Consensus      2377 -~~~~~~ 2382 (2389)
                       .|-.|+
T Consensus       493 ~sG~lAv  499 (514)
T KOG2055|consen  493 NSGYLAV  499 (514)
T ss_pred             CCceEEe
Confidence             444444


No 177
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=98.60  E-value=1.6e-07  Score=111.01  Aligned_cols=145  Identities=17%  Similarity=0.199  Sum_probs=112.7

Q ss_pred             EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCC---EEEEEECCCCCEEEEEeCCCcEEEeeCCCC
Q 000080         2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALAS---ISALQFDHYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus      2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~---V~sVaFSPDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
                      -.|+..++|+.|.|.-|+|||.-+|+....|+..   +     |.+.   -.+++|||||..|..|. .++||+.|+...
T Consensus       119 ~qP~t~l~a~ssr~~PIh~wdaftG~lraSy~~y---d-----h~de~taAhsL~Fs~DGeqlfaGy-krcirvFdt~Rp  189 (406)
T KOG2919|consen  119 DQPSTNLFAVSSRDQPIHLWDAFTGKLRASYRAY---D-----HQDEYTAAHSLQFSPDGEQLFAGY-KRCIRVFDTSRP  189 (406)
T ss_pred             CCCccceeeeccccCceeeeeccccccccchhhh---h-----hHHhhhhheeEEecCCCCeEeecc-cceEEEeeccCC
Confidence            3477889999999999999999999998888632   1     3343   35799999999887664 589999999444


Q ss_pred             CccCcccceeee-----ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2304 GRSNVRPMESCL-----CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2304 grs~~k~l~tl~-----gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      ||-  .+.++..     |..+.+.+++|+|-+.+.+|.++   -.+++-|+.-  -....++.|-||.++|+-+...|+|
T Consensus       190 Gr~--c~vy~t~~~~k~gq~giisc~a~sP~~~~~~a~gs---Y~q~~giy~~--~~~~pl~llggh~gGvThL~~~edG  262 (406)
T KOG2919|consen  190 GRD--CPVYTTVTKGKFGQKGIISCFAFSPMDSKTLAVGS---YGQRVGIYND--DGRRPLQLLGGHGGGVTHLQWCEDG  262 (406)
T ss_pred             CCC--CcchhhhhcccccccceeeeeeccCCCCcceeeec---ccceeeeEec--CCCCceeeecccCCCeeeEEeccCc
Confidence            442  2333333     33788899999998888999864   5677777663  1345589999999999999999999


Q ss_pred             hhhhccccc
Q 000080         2379 NFALSKCRC 2387 (2389)
Q Consensus      2379 ~~~~s~~~~ 2387 (2389)
                      |...|-.||
T Consensus       263 n~lfsGaRk  271 (406)
T KOG2919|consen  263 NKLFSGARK  271 (406)
T ss_pred             CeecccccC
Confidence            999998887


No 178
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.60  E-value=3.3e-07  Score=114.27  Aligned_cols=144  Identities=12%  Similarity=0.055  Sum_probs=98.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCCcEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDGTVC 2296 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~DgTVk 2296 (2389)
                      .+.+.+|+|||+.||..+.+   ..|++||+.+|+..+... .+          ..+.+.+|||||+.|| +.+.||..+
T Consensus       197 ~v~~p~wSPDG~~la~~s~~~~~~~I~~~dl~~g~~~~l~~-~~----------g~~~~~~~SPDG~~la~~~~~~g~~~  265 (427)
T PRK02889        197 PIISPAWSPDGTKLAYVSFESKKPVVYVHDLATGRRRVVAN-FK----------GSNSAPAWSPDGRTLAVALSRDGNSQ  265 (427)
T ss_pred             CcccceEcCCCCEEEEEEccCCCcEEEEEECCCCCEEEeec-CC----------CCccceEECCCCCEEEEEEccCCCce
Confidence            34778999999999987753   469999999887643211 11          2356899999999987 567889888


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ||.++..+    .....+..|...+.+.+|+| ||+.|+.++  ..++..+||.+....+ ..+.+..+.......+++|
T Consensus       266 Iy~~d~~~----~~~~~lt~~~~~~~~~~wSp-DG~~l~f~s--~~~g~~~Iy~~~~~~g-~~~~lt~~g~~~~~~~~Sp  337 (427)
T PRK02889        266 IYTVNADG----SGLRRLTQSSGIDTEPFFSP-DGRSIYFTS--DRGGAPQIYRMPASGG-AAQRVTFTGSYNTSPRISP  337 (427)
T ss_pred             EEEEECCC----CCcEECCCCCCCCcCeEEcC-CCCEEEEEe--cCCCCcEEEEEECCCC-ceEEEecCCCCcCceEECC
Confidence            88765322    12344555666667789999 999988753  3456788887643333 3344433333345678999


Q ss_pred             cchhhhc
Q 000080         2377 LLNFALS 2383 (2389)
Q Consensus      2377 ~~~~~~s 2383 (2389)
                      +|++++.
T Consensus       338 DG~~Ia~  344 (427)
T PRK02889        338 DGKLLAY  344 (427)
T ss_pred             CCCEEEE
Confidence            9999764


No 179
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.59  E-value=1.2e-07  Score=123.85  Aligned_cols=112  Identities=16%  Similarity=0.128  Sum_probs=92.8

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..+-++.++-||++++|.|+|.+||+|++++++....      +   -.||+++|+++.|.|.  .++|++.|.|.++|+
T Consensus       176 G~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s~~~~~~------~---~fgHsaRvw~~~~~~n--~i~t~gedctcrvW~  244 (967)
T KOG0974|consen  176 GSIFSIVTSLDGRYIASVSDDRSIRLWPIDSREVLGC------T---GFGHSARVWACCFLPN--RIITVGEDCTCRVWG  244 (967)
T ss_pred             CceEEEEEccCCcEEEEEecCcceeeeecccccccCc------c---cccccceeEEEEeccc--eeEEeccceEEEEEe
Confidence            3568999999999999999999999999998876541      1   1479999999999999  999999999999997


Q ss_pred             CCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2300 LEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .+..      .+..+.+|. +.++.++..+ +-.++.|+|   +|+++|+||..
T Consensus       245 ~~~~------~l~~y~~h~g~~iw~~~~~~-~~~~~vT~g---~Ds~lk~~~l~  288 (967)
T KOG0974|consen  245 VNGT------QLEVYDEHSGKGIWKIAVPI-GVIIKVTGG---NDSTLKLWDLN  288 (967)
T ss_pred             cccc------eehhhhhhhhcceeEEEEcC-CceEEEeec---cCcchhhhhhh
Confidence            7642      344566676 6788999998 556666765   99999999973


No 180
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=98.59  E-value=3.9e-07  Score=111.61  Aligned_cols=160  Identities=13%  Similarity=0.147  Sum_probs=124.2

Q ss_pred             ceeeccccccccccccc---------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC
Q 000080         2195 GASALGWETQDDFEDYV---------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV 2265 (2389)
Q Consensus      2195 ~Asg~~~d~~~~~~~~~---------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~ 2265 (2389)
                      ..+| |-....++|++.         |+.-     .|..|.++-+..+||++|..|.|.|-.+.++....+|.    |  
T Consensus        94 ~~sg-G~~~~Vkiwdl~~kl~hr~lkdh~s-----tvt~v~YN~~DeyiAsvs~gGdiiih~~~t~~~tt~f~----~--  161 (673)
T KOG4378|consen   94 EISG-GQSGCVKIWDLRAKLIHRFLKDHQS-----TVTYVDYNNTDEYIASVSDGGDIIIHGTKTKQKTTTFT----I--  161 (673)
T ss_pred             eecc-CcCceeeehhhHHHHHhhhccCCcc-----eeEEEEecCCcceeEEeccCCcEEEEecccCcccccee----c--
Confidence            3445 556667777763         3332     24778999999999999999999999999998887774    2  


Q ss_pred             CCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCC
Q 000080         2266 PPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNG 2343 (2389)
Q Consensus      2266 p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D 2343 (2389)
                         +....|+-+.|||-- ..|.++|.||+|.|||+...     .|+. -...|+.+..+|+|+|.+..+|||.|   .|
T Consensus       162 ---~sgqsvRll~ys~skr~lL~~asd~G~VtlwDv~g~-----sp~~~~~~~HsAP~~gicfspsne~l~vsVG---~D  230 (673)
T KOG4378|consen  162 ---DSGQSVRLLRYSPSKRFLLSIASDKGAVTLWDVQGM-----SPIFHASEAHSAPCRGICFSPSNEALLVSVG---YD  230 (673)
T ss_pred             ---CCCCeEEEeecccccceeeEeeccCCeEEEEeccCC-----CcccchhhhccCCcCcceecCCccceEEEec---cc
Confidence               123678999999997 46778999999999999843     3443 35679999999999998888999986   89


Q ss_pred             CeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2344 INVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2344 ~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +.|.++|+.  ......+|. .+.+..+||+++.|-.
T Consensus       231 kki~~yD~~--s~~s~~~l~-y~~Plstvaf~~~G~~  264 (673)
T KOG4378|consen  231 KKINIYDIR--SQASTDRLT-YSHPLSTVAFSECGTY  264 (673)
T ss_pred             ceEEEeecc--cccccceee-ecCCcceeeecCCceE
Confidence            999999984  334455664 4556889999998864


No 181
>KOG0649 consensus WD40 repeat protein [General function prediction only]
Probab=98.59  E-value=3.2e-07  Score=105.37  Aligned_cols=138  Identities=20%  Similarity=0.266  Sum_probs=102.4

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCce----eeEecccCCCCCCCCCCC-----CCEEEEEECCCCCEEEEEe
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA----TATYGVLPAANVPPPYAL-----ASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~----l~Tl~vl~gh~~p~~GH~-----~~V~sVaFSPDG~~LASgS 2290 (2389)
                      .+|..++|+  ..+|+||++ |.||=|.++.-..    .+.+++      -+|.|.     ..|+++-..|.-+-+..|+
T Consensus        63 gpiy~~~f~--d~~Lls~gd-G~V~gw~W~E~~es~~~K~lwe~------~~P~~~~~~evPeINam~ldP~enSi~~Ag  133 (325)
T KOG0649|consen   63 GPIYYLAFH--DDFLLSGGD-GLVYGWEWNEEEESLATKRLWEV------KIPMQVDAVEVPEINAMWLDPSENSILFAG  133 (325)
T ss_pred             CCeeeeeee--hhheeeccC-ceEEEeeehhhhhhccchhhhhh------cCccccCcccCCccceeEeccCCCcEEEec
Confidence            467899999  456888765 9999999873322    111211      112333     4689999999999899999


Q ss_pred             CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEe--ec--
Q 000080         2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITC--HE-- 2366 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~G--H~-- 2366 (2389)
                      .|+.+.-||+++|     +..+++.||++.|-+|+--..+|++| ||   ++||||||||+  .++++++.++-  |+  
T Consensus       134 GD~~~y~~dlE~G-----~i~r~~rGHtDYvH~vv~R~~~~qil-sG---~EDGtvRvWd~--kt~k~v~~ie~yk~~~~  202 (325)
T KOG0649|consen  134 GDGVIYQVDLEDG-----RIQREYRGHTDYVHSVVGRNANGQIL-SG---AEDGTVRVWDT--KTQKHVSMIEPYKNPNL  202 (325)
T ss_pred             CCeEEEEEEecCC-----EEEEEEcCCcceeeeeeecccCccee-ec---CCCccEEEEec--cccceeEEeccccChhh
Confidence            9999999999998     46688999999999998844366655 65   69999999998  57888877643  22  


Q ss_pred             ------CcEEEEeeccc
Q 000080         2367 ------GLYDLFLPLKL 2377 (2389)
Q Consensus      2367 ------~~V~svA~~~~ 2377 (2389)
                            .+|.++|.+++
T Consensus       203 lRp~~g~wigala~~ed  219 (325)
T KOG0649|consen  203 LRPDWGKWIGALAVNED  219 (325)
T ss_pred             cCcccCceeEEEeccCc
Confidence                  34567776654


No 182
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.58  E-value=1.3e-07  Score=116.69  Aligned_cols=122  Identities=16%  Similarity=0.211  Sum_probs=102.1

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC--CEEEEEeCCCcEEE
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG--HRFASAALDGTVCT 2297 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG--~~LASgS~DgTVkL 2297 (2389)
                      .-|.+++|+.||.+|||||+|..+.+||.-.-+.+....         .||.+-|.++.|=|.-  +.++||+.|.-|+|
T Consensus        51 GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~~~KllhsI~---------TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~l  121 (758)
T KOG1310|consen   51 GCVNCLEWNADGELLASGSDDTRLIVWDPFEYKLLHSIS---------TGHTANIFSVKFVPYTNNRIVLSGAGDKLIKL  121 (758)
T ss_pred             ceecceeecCCCCEEeecCCcceEEeecchhcceeeeee---------cccccceeEEeeeccCCCeEEEeccCcceEEE
Confidence            457899999999999999999999999998778777763         5789999999999873  68999999999999


Q ss_pred             eeCCCC---C--ccCcccceeeeecCCCeeEEEEecCCC-CEEEEeecCCCCCeEEEeeCCCC
Q 000080         2298 WQLEVG---G--RSNVRPMESCLCFSSHAMDVSYITSSG-SVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus      2298 WDl~tg---g--rs~~k~l~tl~gHs~~V~sVAFSP~DG-slLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
                      .|+...   +  .....+...+.||...|-.+|--| +| ..+-+|   |+|||||=.|+..+
T Consensus       122 fdl~~~~~~~~d~~~~~~~~~~~cht~rVKria~~p-~~Phtfwsa---sEDGtirQyDiREp  180 (758)
T KOG1310|consen  122 FDLDSSKEGGMDHGMEETTRCWSCHTDRVKRIATAP-NGPHTFWSA---SEDGTIRQYDIREP  180 (758)
T ss_pred             EecccccccccccCccchhhhhhhhhhhhhheecCC-CCCceEEEe---cCCcceeeecccCC
Confidence            999851   0  002245677899999999999999 66 677776   59999999999643


No 183
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=98.55  E-value=3.3e-07  Score=115.22  Aligned_cols=154  Identities=16%  Similarity=0.165  Sum_probs=120.8

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCC-----------------------------------
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAAN----------------------------------- 2264 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~----------------------------------- 2264 (2389)
                      +++|+|+.+|+|+.||+|-.-|++|++|+..-+.+.+.   ++|.                                   
T Consensus       460 ~G~R~~~vSp~gqhLAsGDr~GnlrVy~Lq~l~~~~~~---eAHesEilcLeyS~p~~~~kLLASasrdRlIHV~Dv~rn  536 (1080)
T KOG1408|consen  460 FGFRALAVSPDGQHLASGDRGGNLRVYDLQELEYTCFM---EAHESEILCLEYSFPVLTNKLLASASRDRLIHVYDVKRN  536 (1080)
T ss_pred             cceEEEEECCCcceecccCccCceEEEEehhhhhhhhe---ecccceeEEEeecCchhhhHhhhhccCCceEEEEecccc
Confidence            57799999999999999999999999998643332211   2222                                   


Q ss_pred             C----CCCCCCCCEEEEEECCCC-------------------------------------------------CEEEEEeC
Q 000080         2265 V----PPPYALASISALQFDHYG-------------------------------------------------HRFASAAL 2291 (2389)
Q Consensus      2265 ~----p~~GH~~~V~sVaFSPDG-------------------------------------------------~~LASgS~ 2291 (2389)
                      +    ..-||+..|++|.|--.|                                                 +.++++..
T Consensus       537 y~l~qtld~HSssITsvKFa~~gln~~MiscGADksimFr~~qk~~~g~~f~r~t~t~~ktTlYDm~Vdp~~k~v~t~cQ  616 (1080)
T KOG1408|consen  537 YDLVQTLDGHSSSITSVKFACNGLNRKMISCGADKSIMFRVNQKASSGRLFPRHTQTLSKTTLYDMAVDPTSKLVVTVCQ  616 (1080)
T ss_pred             cchhhhhcccccceeEEEEeecCCceEEEeccCchhhheehhccccCceeccccccccccceEEEeeeCCCcceEEEEec
Confidence            0    033566666666665444                                                 46677888


Q ss_pred             CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEE
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDL 2371 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~s 2371 (2389)
                      |+.|+++|++.|.  ..+.++.-++|.+..-.|...| +|-+|||.   ..|+|+.+.|.  -+++|+....||...|+.
T Consensus       617 Drnirif~i~sgK--q~k~FKgs~~~eG~lIKv~lDP-SgiY~atS---csdktl~~~Df--~sgEcvA~m~GHsE~VTG  688 (1080)
T KOG1408|consen  617 DRNIRIFDIESGK--QVKSFKGSRDHEGDLIKVILDP-SGIYLATS---CSDKTLCFVDF--VSGECVAQMTGHSEAVTG  688 (1080)
T ss_pred             ccceEEEeccccc--eeeeecccccCCCceEEEEECC-CccEEEEe---ecCCceEEEEe--ccchhhhhhcCcchheee
Confidence            9999999999874  4466777788988888899999 99999995   68999999998  579999999999999999


Q ss_pred             Eeecccchhhhcc
Q 000080         2372 FLPLKLLNFALSK 2384 (2389)
Q Consensus      2372 vA~~~~~~~~~s~ 2384 (2389)
                      +-|.+|-+-..|-
T Consensus       689 ~kF~nDCkHlISv  701 (1080)
T KOG1408|consen  689 VKFLNDCKHLISV  701 (1080)
T ss_pred             eeecccchhheee
Confidence            9999987766553


No 184
>KOG2919 consensus Guanine nucleotide-binding protein [General function prediction only]
Probab=98.55  E-value=3.4e-07  Score=108.33  Aligned_cols=137  Identities=15%  Similarity=0.208  Sum_probs=112.4

Q ss_pred             EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEee
Q 000080         2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQ 2299 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWD 2299 (2389)
                      +..++|||... .+|.||...++-|+....++.+.++.          ||.+.|+.++|.+||++|-||+. |-.|-.||
T Consensus       210 isc~a~sP~~~~~~a~gsY~q~~giy~~~~~~pl~llg----------gh~gGvThL~~~edGn~lfsGaRk~dkIl~WD  279 (406)
T KOG2919|consen  210 ISCFAFSPMDSKTLAVGSYGQRVGIYNDDGRRPLQLLG----------GHGGGVTHLQWCEDGNKLFSGARKDDKILCWD  279 (406)
T ss_pred             eeeeeccCCCCcceeeecccceeeeEecCCCCceeeec----------ccCCCeeeEEeccCcCeecccccCCCeEEEEe
Confidence            57889999766 99999999999999987777887763          67899999999999999999885 77899999


Q ss_pred             CCCCCccCcccceeeeecCCCee-EEEEe--cCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAM-DVSYI--TSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~-sVAFS--P~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ++..+    .++..+..|...-+ .|-|.  | +|++||+|   +.||.|++||+. ..++.+..+..|..-|+.|+.+|
T Consensus       280 iR~~~----~pv~~L~rhv~~TNQRI~FDld~-~~~~LasG---~tdG~V~vwdlk-~~gn~~sv~~~~sd~vNgvslnP  350 (406)
T KOG2919|consen  280 IRYSR----DPVYALERHVGDTNQRILFDLDP-KGEILASG---DTDGSVRVWDLK-DLGNEVSVTGNYSDTVNGVSLNP  350 (406)
T ss_pred             ehhcc----chhhhhhhhccCccceEEEecCC-CCceeecc---CCCccEEEEecC-CCCCcccccccccccccceecCc
Confidence            99763    68888888876322 34454  6 89999986   589999999983 34666778888888888888887


Q ss_pred             c
Q 000080         2377 L 2377 (2389)
Q Consensus      2377 ~ 2377 (2389)
                      -
T Consensus       351 ~  351 (406)
T KOG2919|consen  351 I  351 (406)
T ss_pred             c
Confidence            5


No 185
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.53  E-value=8.8e-07  Score=110.77  Aligned_cols=142  Identities=11%  Similarity=0.054  Sum_probs=97.5

Q ss_pred             eEEEEEEcCCCCeEEEEe---CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCC--c
Q 000080         2221 STRAFSSHPLRPFFLVGS---SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDG--T 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS---~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~Dg--T 2294 (2389)
                      .+.+.+|||||+.||..+   .+..|++||+.+|+...... ++       +|   +.+++|||||++||.. +.+|  .
T Consensus       200 ~~~~p~wSPDG~~la~~s~~~g~~~i~i~dl~~G~~~~l~~-~~-------~~---~~~~~~SPDG~~La~~~~~~g~~~  268 (429)
T PRK03629        200 PLMSPAWSPDGSKLAYVTFESGRSALVIQTLANGAVRQVAS-FP-------RH---NGAPAFSPDGSKLAFALSKTGSLN  268 (429)
T ss_pred             ceeeeEEcCCCCEEEEEEecCCCcEEEEEECCCCCeEEccC-CC-------CC---cCCeEECCCCCEEEEEEcCCCCcE
Confidence            457889999999988654   35689999998886533211 12       22   4568999999999865 4455  4


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      |.+||++++.      ...+..+...+...+|+| ||+.|+.++  ..++..+||.+... +...+.+..+.....+.++
T Consensus       269 I~~~d~~tg~------~~~lt~~~~~~~~~~wSP-DG~~I~f~s--~~~g~~~Iy~~d~~-~g~~~~lt~~~~~~~~~~~  338 (429)
T PRK03629        269 LYVMDLASGQ------IRQVTDGRSNNTEPTWFP-DSQNLAYTS--DQAGRPQVYKVNIN-GGAPQRITWEGSQNQDADV  338 (429)
T ss_pred             EEEEECCCCC------EEEccCCCCCcCceEECC-CCCEEEEEe--CCCCCceEEEEECC-CCCeEEeecCCCCccCEEE
Confidence            8889998762      233344445677899999 999998753  24456677754322 3345566655556678899


Q ss_pred             cccchhhhc
Q 000080         2375 LKLLNFALS 2383 (2389)
Q Consensus      2375 ~~~~~~~~s 2383 (2389)
                      +|+|++++-
T Consensus       339 SpDG~~Ia~  347 (429)
T PRK03629        339 SSDGKFMVM  347 (429)
T ss_pred             CCCCCEEEE
Confidence            999998753


No 186
>KOG4378 consensus Nuclear protein COP1 [Signal transduction mechanisms]
Probab=98.52  E-value=7.3e-07  Score=109.32  Aligned_cols=137  Identities=12%  Similarity=0.190  Sum_probs=108.4

Q ss_pred             eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkL 2297 (2389)
                      .||-+.|||..+ +|.++|+||+|.|||+ +|. .+..+.  .       .|.+.-+.|+|||-. ..|+|.+.|..|.+
T Consensus       166 svRll~ys~skr~lL~~asd~G~VtlwDv-~g~sp~~~~~--~-------~HsAP~~gicfspsne~l~vsVG~Dkki~~  235 (673)
T KOG4378|consen  166 SVRLLRYSPSKRFLLSIASDKGAVTLWDV-QGMSPIFHAS--E-------AHSAPCRGICFSPSNEALLVSVGYDKKINI  235 (673)
T ss_pred             eEEEeecccccceeeEeeccCCeEEEEec-cCCCcccchh--h-------hccCCcCcceecCCccceEEEecccceEEE
Confidence            468889999988 4677999999999998 454 443332  2       366788999999986 79999999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      +|++.. +    ....+ .-+.+..+|||++ +|.+|+.|   +..|-|.-+|+. .+...+..+..|.+.|++||+.+.
T Consensus       236 yD~~s~-~----s~~~l-~y~~Plstvaf~~-~G~~L~aG---~s~G~~i~YD~R-~~k~Pv~v~sah~~sVt~vafq~s  304 (673)
T KOG4378|consen  236 YDIRSQ-A----STDRL-TYSHPLSTVAFSE-CGTYLCAG---NSKGELIAYDMR-STKAPVAVRSAHDASVTRVAFQPS  304 (673)
T ss_pred             eecccc-c----cccee-eecCCcceeeecC-CceEEEee---cCCceEEEEecc-cCCCCceEeeecccceeEEEeeec
Confidence            999864 2    22222 2456778999999 99999864   577889999985 445669999999999999999886


Q ss_pred             c
Q 000080         2378 L 2378 (2389)
Q Consensus      2378 ~ 2378 (2389)
                      -
T Consensus       305 ~  305 (673)
T KOG4378|consen  305 P  305 (673)
T ss_pred             c
Confidence            4


No 187
>KOG2394 consensus WD40 protein DMR-N9 [General function prediction only]
Probab=98.52  E-value=5.4e-07  Score=111.58  Aligned_cols=150  Identities=19%  Similarity=0.226  Sum_probs=105.7

Q ss_pred             CCCcCceeEEEEEEcCCCC-eEEEEeCCCcEEEeecC--------------CCcee--eEecccCCCCCC----CCCCCC
Q 000080         2214 PATVENISTRAFSSHPLRP-FFLVGSSNTHIYLWEFG--------------KDKAT--ATYGVLPAANVP----PPYALA 2272 (2389)
Q Consensus      2214 ~atv~ni~VrsVAFsPdG~-~LASGS~DgTIRLWDl~--------------tGk~l--~Tl~vl~gh~~p----~~GH~~ 2272 (2389)
                      .+.++.-+|.+|.|=|.+. .++.+-.+|.++++|..              .|...  .+-..-...| |    ..+ .+
T Consensus       214 ~r~i~ktsvT~ikWvpg~~~~Fl~a~~sGnlyly~~~~~~~~t~p~~~~~k~~~~f~i~t~ksk~~rN-Pv~~w~~~-~g  291 (636)
T KOG2394|consen  214 ERLINKSSVTCIKWVPGSDSLFLVAHASGNLYLYDKEIVCGATAPSYQALKDGDQFAILTSKSKKTRN-PVARWHIG-EG  291 (636)
T ss_pred             cccccccceEEEEEEeCCCceEEEEEecCceEEeeccccccCCCCcccccCCCCeeEEeeeeccccCC-ccceeEec-cc
Confidence            3455555789999999665 45556789999999753              11100  0000000000 1    011 24


Q ss_pred             CEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2273 SISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2273 ~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .|...+|||||+.||+.|.||.+||.|..+..  .+-.++++-   +...+|+||| ||++|||||   +|-.|.||.+ 
T Consensus       292 ~in~f~FS~DG~~LA~VSqDGfLRvF~fdt~e--Llg~mkSYF---GGLLCvcWSP-DGKyIvtGG---EDDLVtVwSf-  361 (636)
T KOG2394|consen  292 SINEFAFSPDGKYLATVSQDGFLRIFDFDTQE--LLGVMKSYF---GGLLCVCWSP-DGKYIVTGG---EDDLVTVWSF-  361 (636)
T ss_pred             cccceeEcCCCceEEEEecCceEEEeeccHHH--HHHHHHhhc---cceEEEEEcC-CccEEEecC---CcceEEEEEe-
Confidence            68889999999999999999999999998742  111222222   4677899999 999999975   9999999998 


Q ss_pred             CCCCCceEEEEeecCcEEEEeecc
Q 000080         2353 APPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2353 ~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                       +..+.|..=+||..||..|||.|
T Consensus       362 -~erRVVARGqGHkSWVs~VaFDp  384 (636)
T KOG2394|consen  362 -EERRVVARGQGHKSWVSVVAFDP  384 (636)
T ss_pred             -ccceEEEeccccccceeeEeecc
Confidence             45666888999999999999985


No 188
>KOG1188 consensus WD40 repeat protein [General function prediction only]
Probab=98.51  E-value=3.6e-07  Score=108.87  Aligned_cols=133  Identities=17%  Similarity=0.162  Sum_probs=97.9

Q ss_pred             CeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC--CCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080         2232 PFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH--YGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus      2232 ~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP--DG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
                      ..+|+|=..|+|||+|..+|+.+..|.+          |.+.+..|+|..  .++.+.||+.|||||+||+++.++   .
T Consensus        41 ~~vav~lSngsv~lyd~~tg~~l~~fk~----------~~~~~N~vrf~~~ds~h~v~s~ssDG~Vr~wD~Rs~~e---~  107 (376)
T KOG1188|consen   41 TAVAVSLSNGSVRLYDKGTGQLLEEFKG----------PPATTNGVRFISCDSPHGVISCSSDGTVRLWDIRSQAE---S  107 (376)
T ss_pred             eeEEEEecCCeEEEEeccchhhhheecC----------CCCcccceEEecCCCCCeeEEeccCCeEEEEEeecchh---h
Confidence            4588888999999999999998888863          234467888876  468899999999999999998643   4


Q ss_pred             cceeeeecCC-CeeEEEEecCCCCEEEEeec-CCCCCeEEEeeCCCCCCCceE-EEEeecCcEEEEeecccch
Q 000080         2310 PMESCLCFSS-HAMDVSYITSSGSVIAAAGH-SSNGINVVVWDTLAPPTSSRA-SITCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2310 ~l~tl~gHs~-~V~sVAFSP~DGslLASAG~-sS~D~TVrLWD~l~~tg~~v~-sL~GH~~~V~svA~~~~~~ 2379 (2389)
                      +.....+|++ .-.+++-+- .++++|+|-- .-.|..|.+||+... .+.+. -.+.|.+.|++|-|+|+-.
T Consensus       108 a~~~~~~~~~~~f~~ld~nc-k~~ii~~GtE~~~s~A~v~lwDvR~~-qq~l~~~~eSH~DDVT~lrFHP~~p  178 (376)
T KOG1188|consen  108 ARISWTQQSGTPFICLDLNC-KKNIIACGTELTRSDASVVLWDVRSE-QQLLRQLNESHNDDVTQLRFHPSDP  178 (376)
T ss_pred             hheeccCCCCCcceEeeccC-cCCeEEeccccccCceEEEEEEeccc-cchhhhhhhhccCcceeEEecCCCC
Confidence            5666677773 333455443 5678886410 115778999999532 23244 4588999999999999754


No 189
>KOG0307 consensus Vesicle coat complex COPII, subunit SEC31 [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.49  E-value=2.7e-07  Score=121.52  Aligned_cols=168  Identities=12%  Similarity=0.163  Sum_probs=130.5

Q ss_pred             ccccceeeccccccccccccccCCCCcCc------eeEEEEEEcCC-CCeEEEEeCCCcEEEeecCCCceeeEecccCCC
Q 000080         2191 YAGIGASALGWETQDDFEDYVDPPATVEN------ISTRAFSSHPL-RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA 2263 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~d~~atv~n------i~VrsVAFsPd-G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh 2263 (2389)
                      ++-.+||| +.|..+=+|+...+......      -.|..|+|+.. ..+||||+.+|.+-+||++..+.+..+.   .+
T Consensus       128 q~nlLASG-a~~geI~iWDlnn~~tP~~~~~~~~~~eI~~lsWNrkvqhILAS~s~sg~~~iWDlr~~~pii~ls---~~  203 (1049)
T KOG0307|consen  128 QGNLLASG-ADDGEILIWDLNKPETPFTPGSQAPPSEIKCLSWNRKVSHILASGSPSGRAVIWDLRKKKPIIKLS---DT  203 (1049)
T ss_pred             CCceeecc-CCCCcEEEeccCCcCCCCCCCCCCCcccceEeccchhhhHHhhccCCCCCceeccccCCCcccccc---cC
Confidence            44568888 88888889988754332211      14588999985 5589999999999999999887766553   22


Q ss_pred             CCCCCCCCCCEEEEEECCCC-CEEEEEeCC---CcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080         2264 NVPPPYALASISALQFDHYG-HRFASAALD---GTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus      2264 ~~p~~GH~~~V~sVaFSPDG-~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
                           +..-.+..|+++||+ .+++++++|   -.|++||++...    .|++.+++|+..|.++.|.+.|.++|+|.| 
T Consensus       204 -----~~~~~~S~l~WhP~~aTql~~As~dd~~PviqlWDlR~as----sP~k~~~~H~~GilslsWc~~D~~lllSsg-  273 (1049)
T KOG0307|consen  204 -----PGRMHCSVLAWHPDHATQLLVASGDDSAPVIQLWDLRFAS----SPLKILEGHQRGILSLSWCPQDPRLLLSSG-  273 (1049)
T ss_pred             -----CCccceeeeeeCCCCceeeeeecCCCCCceeEeecccccC----CchhhhcccccceeeeccCCCCchhhhccc-
Confidence                 111348899999998 688888877   469999998752    688889999999999999998879999975 


Q ss_pred             CCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2340 SSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2340 sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                        .|+.|-+|+.  .+++.+..|....+|+.-|-+.|
T Consensus       274 --kD~~ii~wN~--~tgEvl~~~p~~~nW~fdv~w~p  306 (1049)
T KOG0307|consen  274 --KDNRIICWNP--NTGEVLGELPAQGNWCFDVQWCP  306 (1049)
T ss_pred             --CCCCeeEecC--CCceEeeecCCCCcceeeeeecC
Confidence              8999999998  46777888877777777665544


No 190
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=98.48  E-value=8e-07  Score=111.13  Aligned_cols=139  Identities=12%  Similarity=0.132  Sum_probs=100.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|..|+|-|||..|+-+..| .+.++|...|.+++|++          ||.+.|++||+|.||++||||+.|..|-+|.-
T Consensus        14 ci~d~afkPDGsqL~lAAg~-rlliyD~ndG~llqtLK----------gHKDtVycVAys~dGkrFASG~aDK~VI~W~~   82 (1081)
T KOG1538|consen   14 CINDIAFKPDGTQLILAAGS-RLLVYDTSDGTLLQPLK----------GHKDTVYCVAYAKDGKRFASGSADKSVIIWTS   82 (1081)
T ss_pred             chheeEECCCCceEEEecCC-EEEEEeCCCcccccccc----------cccceEEEEEEccCCceeccCCCceeEEEecc
Confidence            34777999999988776544 69999999999999985          57899999999999999999999999999976


Q ss_pred             CCCCc---cC---ccc---------cee--e-------------ee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080         2301 EVGGR---SN---VRP---------MES--C-------------LC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus      2301 ~tggr---s~---~k~---------l~t--l-------------~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
                      ...|-   |+   +++         +.+  +             +-  -+..|.+.+|.. ||+++|-|   -.||||.|
T Consensus        83 klEG~LkYSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~V~K~kss~R~~~CsWtn-DGqylalG---~~nGTIsi  158 (1081)
T KOG1538|consen   83 KLEGILKYSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKSVSKHKSSSRIICCSWTN-DGQYLALG---MFNGTISI  158 (1081)
T ss_pred             cccceeeeccCCeeeEeecCchHHHhhhcchhhccccChhhhhHHhhhhheeEEEeeecC-CCcEEEEe---ccCceEEe
Confidence            54331   00   000         000  0             00  124566788887 99999974   37899998


Q ss_pred             eeCCCCCCCc---eEEEEeecCcEEEEeeccc
Q 000080         2349 WDTLAPPTSS---RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2349 WD~l~~tg~~---v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      =+-   +++.   ++.--|...+|++++..|.
T Consensus       159 RNk---~gEek~~I~Rpgg~Nspiwsi~~~p~  187 (1081)
T KOG1538|consen  159 RNK---NGEEKVKIERPGGSNSPIWSICWNPS  187 (1081)
T ss_pred             ecC---CCCcceEEeCCCCCCCCceEEEecCC
Confidence            874   3433   2333346677888887764


No 191
>KOG1408 consensus WD40 repeat protein [Function unknown]
Probab=98.48  E-value=1e-06  Score=111.08  Aligned_cols=117  Identities=13%  Similarity=0.217  Sum_probs=106.2

Q ss_pred             ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      ...++.++..|+.++++++.+|..|||+|+++|+++++|++.       .+|.+..-.|...|.|.++|+...|+|+.+.
T Consensus       596 ktTlYDm~Vdp~~k~v~t~cQDrnirif~i~sgKq~k~FKgs-------~~~eG~lIKv~lDPSgiY~atScsdktl~~~  668 (1080)
T KOG1408|consen  596 KTTLYDMAVDPTSKLVVTVCQDRNIRIFDIESGKQVKSFKGS-------RDHEGDLIKVILDPSGIYLATSCSDKTLCFV  668 (1080)
T ss_pred             cceEEEeeeCCCcceEEEEecccceEEEeccccceeeeeccc-------ccCCCceEEEEECCCccEEEEeecCCceEEE
Confidence            345689999999999999999999999999999999999753       2567888999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |.-+|     .++.+..||+-.|..+-|.+ |-+.|.|+   |.|+-|-||.+
T Consensus       669 Df~sg-----EcvA~m~GHsE~VTG~kF~n-DCkHlISv---sgDgCIFvW~l  712 (1080)
T KOG1408|consen  669 DFVSG-----ECVAQMTGHSEAVTGVKFLN-DCKHLISV---SGDGCIFVWKL  712 (1080)
T ss_pred             Eeccc-----hhhhhhcCcchheeeeeecc-cchhheee---cCCceEEEEEC
Confidence            99997     47888899999999999999 88888887   58999999997


No 192
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.47  E-value=1.1e-06  Score=109.74  Aligned_cols=140  Identities=13%  Similarity=0.061  Sum_probs=94.7

Q ss_pred             EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCC--cE
Q 000080         2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDG--TV 2295 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~Dg--TV 2295 (2389)
                      +.+.+|+|||+.|+..+.+   ..|++||+.+|+.... ...          .+.+.+++|||||++|| +.+.+|  .|
T Consensus       206 v~~p~wSpDg~~la~~s~~~~~~~l~~~dl~~g~~~~l-~~~----------~g~~~~~~~SpDG~~l~~~~s~~g~~~I  274 (433)
T PRK04922        206 ILSPAWSPDGKKLAYVSFERGRSAIYVQDLATGQRELV-ASF----------RGINGAPSFSPDGRRLALTLSRDGNPEI  274 (433)
T ss_pred             cccccCCCCCCEEEEEecCCCCcEEEEEECCCCCEEEe-ccC----------CCCccCceECCCCCEEEEEEeCCCCceE
Confidence            4677999999999988743   4799999988875432 111          12345789999999886 445555  59


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      .+||++++.      ...+..|.....+++|+| ||+.|+.++  ..++..+||.+...+++ .+.+..+.......+.+
T Consensus       275 y~~d~~~g~------~~~lt~~~~~~~~~~~sp-DG~~l~f~s--d~~g~~~iy~~dl~~g~-~~~lt~~g~~~~~~~~S  344 (433)
T PRK04922        275 YVMDLGSRQ------LTRLTNHFGIDTEPTWAP-DGKSIYFTS--DRGGRPQIYRVAASGGS-AERLTFQGNYNARASVS  344 (433)
T ss_pred             EEEECCCCC------eEECccCCCCccceEECC-CCCEEEEEE--CCCCCceEEEEECCCCC-eEEeecCCCCccCEEEC
Confidence            999998762      344555665667899999 999988753  24455455544223333 44444344445578999


Q ss_pred             ccchhhh
Q 000080         2376 KLLNFAL 2382 (2389)
Q Consensus      2376 ~~~~~~~ 2382 (2389)
                      |+|+++.
T Consensus       345 pDG~~Ia  351 (433)
T PRK04922        345 PDGKKIA  351 (433)
T ss_pred             CCCCEEE
Confidence            9998865


No 193
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=98.47  E-value=8.7e-07  Score=111.15  Aligned_cols=105  Identities=11%  Similarity=-0.006  Sum_probs=92.4

Q ss_pred             CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2267 PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2267 ~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      ..+|-+.|.++..+.+-..|=|++.|+.|..|+...+     +.++.+.+-...+.+++++| ||..|++|+     ++|
T Consensus        98 t~~h~~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~-----~~~~~~~~~~~~~~sl~is~-D~~~l~~as-----~~i  166 (541)
T KOG4547|consen   98 TDKHYGNVNEILDAQRLGCIYSVGADLKVVYILEKEK-----VIIRIWKEQKPLVSSLCISP-DGKILLTAS-----RQI  166 (541)
T ss_pred             cCCCCCcceeeecccccCceEecCCceeEEEEecccc-----eeeeeeccCCCccceEEEcC-CCCEEEecc-----ceE
Confidence            4678888999999999899999999999999999875     45667778888899999999 899999974     899


Q ss_pred             EEeeCCCCCCCceEEEEeecCcEEEEeeccc-----chhhhcc
Q 000080         2347 VVWDTLAPPTSSRASITCHEGLYDLFLPLKL-----LNFALSK 2384 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~GH~~~V~svA~~~~-----~~~~~s~ 2384 (2389)
                      ++||+  .+++-+++|.||.+.|+++++-++     |.+.||-
T Consensus       167 k~~~~--~~kevv~~ftgh~s~v~t~~f~~~~~g~~G~~vLss  207 (541)
T KOG4547|consen  167 KVLDI--ETKEVVITFTGHGSPVRTLSFTTLIDGIIGKYVLSS  207 (541)
T ss_pred             EEEEc--cCceEEEEecCCCcceEEEEEEEeccccccceeeec
Confidence            99998  577889999999999999999998     8887764


No 194
>PRK01742 tolB translocation protein TolB; Provisional
Probab=98.46  E-value=5.6e-07  Score=112.23  Aligned_cols=124  Identities=13%  Similarity=0.073  Sum_probs=90.8

Q ss_pred             eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcEEEeeCCCCCccCcccceee
Q 000080         2238 SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus      2238 S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl 2314 (2389)
                      +.+.+|++||. +|...+.+.          +|...|.+++|||||++||.++.+   .+|.+||++++.+   +.+..+
T Consensus       181 ~~~~~i~i~d~-dg~~~~~lt----------~~~~~v~~p~wSPDG~~la~~s~~~~~~~i~i~dl~tg~~---~~l~~~  246 (429)
T PRK01742        181 SQPYEVRVADY-DGFNQFIVN----------RSSQPLMSPAWSPDGSKLAYVSFENKKSQLVVHDLRSGAR---KVVASF  246 (429)
T ss_pred             CceEEEEEECC-CCCCceEec----------cCCCccccceEcCCCCEEEEEEecCCCcEEEEEeCCCCce---EEEecC
Confidence            34689999998 455455542          244679999999999999998765   3799999988631   334444


Q ss_pred             eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      .+|.   .+++|+| ||+.||.++  +.|+.++||.+... +..+..+..|...+.+.+++|+|++++
T Consensus       247 ~g~~---~~~~wSP-DG~~La~~~--~~~g~~~Iy~~d~~-~~~~~~lt~~~~~~~~~~wSpDG~~i~  307 (429)
T PRK01742        247 RGHN---GAPAFSP-DGSRLAFAS--SKDGVLNIYVMGAN-GGTPSQLTSGAGNNTEPSWSPDGQSIL  307 (429)
T ss_pred             CCcc---CceeECC-CCCEEEEEE--ecCCcEEEEEEECC-CCCeEeeccCCCCcCCEEECCCCCEEE
Confidence            4443   4689999 999999863  46787777754323 344677888888889999999999765


No 195
>PRK11028 6-phosphogluconolactonase; Provisional
Probab=98.46  E-value=2.4e-06  Score=102.08  Aligned_cols=140  Identities=12%  Similarity=0.166  Sum_probs=92.5

Q ss_pred             EEEEEEcCCCCeEEEEeC-CCcEEEeecCC--Cc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcE
Q 000080         2222 TRAFSSHPLRPFFLVGSS-NTHIYLWEFGK--DK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTV 2295 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~-DgTIRLWDl~t--Gk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTV 2295 (2389)
                      .+.++|+|||++++++.. +++|.+||+..  |+  .+.++...|.+.   . +..+...++|+|||+++.++. .+++|
T Consensus       177 p~~~~~~pdg~~lyv~~~~~~~v~v~~~~~~~~~~~~~~~~~~~p~~~---~-~~~~~~~i~~~pdg~~lyv~~~~~~~I  252 (330)
T PRK11028        177 PRHMVFHPNQQYAYCVNELNSSVDVWQLKDPHGEIECVQTLDMMPADF---S-DTRWAADIHITPDGRHLYACDRTASLI  252 (330)
T ss_pred             CceEEECCCCCEEEEEecCCCEEEEEEEeCCCCCEEEEEEEecCCCcC---C-CCccceeEEECCCCCEEEEecCCCCeE
Confidence            478899999999887776 99999999973  33  344443222210   1 123456799999999888885 58999


Q ss_pred             EEeeCCCCCccCcccceeeeecC---CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeecCcEE
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFS---SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHEGLYD 2370 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs---~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~~~V~ 2370 (2389)
                      .+|+++..+     ...++.+|.   ...+.++|+| ||++|++++  ..+++|.+|++...++..  ++++.. ..+-.
T Consensus       253 ~v~~i~~~~-----~~~~~~~~~~~~~~p~~~~~~~-dg~~l~va~--~~~~~v~v~~~~~~~g~l~~~~~~~~-g~~P~  323 (330)
T PRK11028        253 SVFSVSEDG-----SVLSFEGHQPTETQPRGFNIDH-SGKYLIAAG--QKSHHISVYEIDGETGLLTELGRYAV-GQGPM  323 (330)
T ss_pred             EEEEEeCCC-----CeEEEeEEEeccccCCceEECC-CCCEEEEEE--ccCCcEEEEEEcCCCCcEEEcccccc-CCCce
Confidence            999997542     111222332   2456799999 999999874  468999999874344432  344443 33444


Q ss_pred             EEee
Q 000080         2371 LFLP 2374 (2389)
Q Consensus      2371 svA~ 2374 (2389)
                      |+++
T Consensus       324 ~~~~  327 (330)
T PRK11028        324 WVSV  327 (330)
T ss_pred             EEEE
Confidence            5554


No 196
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=98.45  E-value=2.3e-06  Score=104.73  Aligned_cols=139  Identities=14%  Similarity=0.059  Sum_probs=97.0

Q ss_pred             EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCC--cE
Q 000080         2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDG--TV 2295 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~Dg--TV 2295 (2389)
                      +.+.+|+|||++||.++.+   .+|++||+.+|+......           +...+.+++|+|||+.|+. .+.++  .|
T Consensus       192 ~~~p~~Spdg~~la~~~~~~~~~~i~v~d~~~g~~~~~~~-----------~~~~~~~~~~spDg~~l~~~~~~~~~~~i  260 (417)
T TIGR02800       192 ILSPAWSPDGQKLAYVSFESGKPEIYVQDLATGQREKVAS-----------FPGMNGAPAFSPDGSKLAVSLSKDGNPDI  260 (417)
T ss_pred             eecccCCCCCCEEEEEEcCCCCcEEEEEECCCCCEEEeec-----------CCCCccceEECCCCCEEEEEECCCCCccE
Confidence            4677999999999987754   489999998886543221           1234677899999998874 44444  58


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEEe
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLFL 2373 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~svA 2373 (2389)
                      .+||++++.      ...+..|.......+|+| ||+.|+.++  ..++  .|.+||+  . +...+.+..+...+..++
T Consensus       261 ~~~d~~~~~------~~~l~~~~~~~~~~~~s~-dg~~l~~~s--~~~g~~~iy~~d~--~-~~~~~~l~~~~~~~~~~~  328 (417)
T TIGR02800       261 YVMDLDGKQ------LTRLTNGPGIDTEPSWSP-DGKSIAFTS--DRGGSPQIYMMDA--D-GGEVRRLTFRGGYNASPS  328 (417)
T ss_pred             EEEECCCCC------EEECCCCCCCCCCEEECC-CCCEEEEEE--CCCCCceEEEEEC--C-CCCEEEeecCCCCccCeE
Confidence            888998752      233444555556788999 999888753  2333  5666675  2 334566766777778889


Q ss_pred             ecccchhhhc
Q 000080         2374 PLKLLNFALS 2383 (2389)
Q Consensus      2374 ~~~~~~~~~s 2383 (2389)
                      .+|+|++++-
T Consensus       329 ~spdg~~i~~  338 (417)
T TIGR02800       329 WSPDGDLIAF  338 (417)
T ss_pred             ECCCCCEEEE
Confidence            9999987664


No 197
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=98.44  E-value=2.3e-06  Score=105.58  Aligned_cols=138  Identities=15%  Similarity=0.193  Sum_probs=110.3

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      .+.++-||+.++++|+++|++++||+  ..+..-+-..           .+.+.++.|.|.| .+|.|...|..-+-|.+
T Consensus       371 lwgla~hps~~q~~T~gqdk~v~lW~--~~k~~wt~~~-----------~d~~~~~~fhpsg-~va~Gt~~G~w~V~d~e  436 (626)
T KOG2106|consen  371 LWGLATHPSKNQLLTCGQDKHVRLWN--DHKLEWTKII-----------EDPAECADFHPSG-VVAVGTATGRWFVLDTE  436 (626)
T ss_pred             eeeEEcCCChhheeeccCcceEEEcc--CCceeEEEEe-----------cCceeEeeccCcc-eEEEeeccceEEEEecc
Confidence            47889999999999999999999999  4455444321           2668999999999 99999999999999999


Q ss_pred             CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE-EeecCcEEEEeecccchh
Q 000080         2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI-TCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL-~GH~~~V~svA~~~~~~~ 2380 (2389)
                      +.     ..+....+ +.+++.|+|+| ||.+||.|   |.|+.|.|+.+. +.+...... .+|-..|+-+..+.+++|
T Consensus       437 ~~-----~lv~~~~d-~~~ls~v~ysp-~G~~lAvg---s~d~~iyiy~Vs-~~g~~y~r~~k~~gs~ithLDwS~Ds~~  505 (626)
T KOG2106|consen  437 TQ-----DLVTIHTD-NEQLSVVRYSP-DGAFLAVG---SHDNHIYIYRVS-ANGRKYSRVGKCSGSPITHLDWSSDSQF  505 (626)
T ss_pred             cc-----eeEEEEec-CCceEEEEEcC-CCCEEEEe---cCCCeEEEEEEC-CCCcEEEEeeeecCceeEEeeecCCCce
Confidence            74     23444444 78899999999 99999986   799999999984 445443333 445578899999999988


Q ss_pred             hhcc
Q 000080         2381 ALSK 2384 (2389)
Q Consensus      2381 ~~s~ 2384 (2389)
                      ..+.
T Consensus       506 ~~~~  509 (626)
T KOG2106|consen  506 LVSN  509 (626)
T ss_pred             EEec
Confidence            7764


No 198
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.40  E-value=5.1e-06  Score=102.90  Aligned_cols=211  Identities=16%  Similarity=0.248  Sum_probs=133.2

Q ss_pred             eEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-EecCCeEEEEeeCCCCCCC
Q 000080           54 SWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA-AASENCIFVFAHDSASSKG  132 (2389)
Q Consensus        54 ~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa-ASyDntIRVw~~d~~~~kg  132 (2389)
                      .|+.+.+.+.++|+.  --.. -|.        .++.|.  ..|.+-+|+||   +.-|+ |+-|+.|++|...     |
T Consensus        77 ~~~i~s~DGkf~il~--k~~r-VE~--------sv~AH~--~A~~~gRW~~d---GtgLlt~GEDG~iKiWSrs-----G  135 (737)
T KOG1524|consen   77 TLLICSNDGRFVILN--KSAR-VER--------SISAHA--AAISSGRWSPD---GAGLLTAGEDGVIKIWSRS-----G  135 (737)
T ss_pred             eEEEEcCCceEEEec--ccch-hhh--------hhhhhh--hhhhhcccCCC---CceeeeecCCceEEEEecc-----c
Confidence            355566655666665  2111 121        234443  47999999998   44455 5669999999886     1


Q ss_pred             CccceeeEEec-ccceEEEEeecCCCCeEEEEecc-eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeeccc
Q 000080          133 SFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME-TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMS  209 (2389)
Q Consensus       133 d~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD-V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~di  209 (2389)
                      -.    +.++. ....|++++|.|+++.++-|-.+ +-|=-....+-.+-|+   .|..-+.+++|++... +||+|.|.
T Consensus       136 ML----RStl~Q~~~~v~c~~W~p~S~~vl~c~g~h~~IKpL~~n~k~i~Wk---AHDGiiL~~~W~~~s~lI~sgGED~  208 (737)
T KOG1524|consen  136 ML----RSTVVQNEESIRCARWAPNSNSIVFCQGGHISIKPLAANSKIIRWR---AHDGLVLSLSWSTQSNIIASGGEDF  208 (737)
T ss_pred             hH----HHHHhhcCceeEEEEECCCCCceEEecCCeEEEeecccccceeEEe---ccCcEEEEeecCccccceeecCCce
Confidence            11    22333 36689999999999999965555 5443344445555564   4666677999999877 99999999


Q ss_pred             ccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCc
Q 000080          210 QLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGK  289 (2389)
Q Consensus       210 kf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk  289 (2389)
                      ||++|              |+-....+.-.+|.-+|.+|+|+|        |      ...|-+|+ +|.|+=+      
T Consensus       209 kfKvW--------------D~~G~~Lf~S~~~ey~ITSva~np--------d------~~~~v~S~-nt~R~~~------  253 (737)
T KOG1524|consen  209 RFKIW--------------DAQGANLFTSAAEEYAITSVAFNP--------E------KDYLLWSY-NTARFSS------  253 (737)
T ss_pred             eEEee--------------cccCcccccCChhccceeeeeecc--------c------cceeeeee-eeeeecC------
Confidence            98877              333444566789999999999999        3      23555554 5666211      


Q ss_pred             ccccccccCCCCccceeEEEEEEEeecccccCCCCCCeEEEeeccccce
Q 000080          290 TRKVAKDTNDHKTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCM  338 (2389)
Q Consensus       290 ~kk~~~~~~d~~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~v  338 (2389)
                                 .+++--|-++=++.=-|..-||--+-+++--+.++..+
T Consensus       254 -----------p~~GSifnlsWS~DGTQ~a~gt~~G~v~~A~~ieq~l~  291 (737)
T KOG1524|consen  254 -----------PRVGSIFNLSWSADGTQATCGTSTGQLIVAYAIEQQLV  291 (737)
T ss_pred             -----------CCccceEEEEEcCCCceeeccccCceEEEeeeehhhhh
Confidence                       23455566666666334333333333444444444444


No 199
>KOG2055 consensus WD40 repeat protein [General function prediction only]
Probab=98.39  E-value=1.8e-06  Score=105.87  Aligned_cols=159  Identities=16%  Similarity=0.167  Sum_probs=119.6

Q ss_pred             cccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCCEEEEEEC
Q 000080         2204 QDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALASISALQFD 2280 (2389)
Q Consensus      2204 ~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~V~sVaFS 2280 (2389)
                      ..++.+++..-.+.  -+|++|.|||..+.|++|+.|+++||+.+. |+   .++.+. +         -.-.|.+..|.
T Consensus       200 ~krlkDaNa~~ps~--~~I~sv~FHp~~plllvaG~d~~lrifqvD-Gk~N~~lqS~~-l---------~~fPi~~a~f~  266 (514)
T KOG2055|consen  200 IKRLKDANAAHPSH--GGITSVQFHPTAPLLLVAGLDGTLRIFQVD-GKVNPKLQSIH-L---------EKFPIQKAEFA  266 (514)
T ss_pred             eEeecccccCCcCc--CCceEEEecCCCceEEEecCCCcEEEEEec-CccChhheeee-e---------ccCccceeeec
Confidence            44555554222222  245999999999999999999999999995 54   233332 1         12458999999


Q ss_pred             CCCC-EEEEEeCCCcEEEeeCCCCCccCcccceeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc
Q 000080         2281 HYGH-RFASAALDGTVCTWQLEVGGRSNVRPMESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS 2358 (2389)
Q Consensus      2281 PDG~-~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~ 2358 (2389)
                      |+|+ .+++++.-.-...||++++.   ...+....|+. ..+..+..+| +|++||.+|   ..|-|-|=-.  .+++.
T Consensus       267 p~G~~~i~~s~rrky~ysyDle~ak---~~k~~~~~g~e~~~~e~FeVSh-d~~fia~~G---~~G~I~lLha--kT~el  337 (514)
T KOG2055|consen  267 PNGHSVIFTSGRRKYLYSYDLETAK---VTKLKPPYGVEEKSMERFEVSH-DSNFIAIAG---NNGHIHLLHA--KTKEL  337 (514)
T ss_pred             CCCceEEEecccceEEEEeeccccc---cccccCCCCcccchhheeEecC-CCCeEEEcc---cCceEEeehh--hhhhh
Confidence            9998 99999999999999999873   23444444544 5567788999 999999997   6788888665  45666


Q ss_pred             eEEEEeecCcEEEEeecccchhhhccc
Q 000080         2359 RASITCHEGLYDLFLPLKLLNFALSKC 2385 (2389)
Q Consensus      2359 v~sL~GH~~~V~svA~~~~~~~~~s~~ 2385 (2389)
                      +.++. -++.|..++++.+|..++.-|
T Consensus       338 i~s~K-ieG~v~~~~fsSdsk~l~~~~  363 (514)
T KOG2055|consen  338 ITSFK-IEGVVSDFTFSSDSKELLASG  363 (514)
T ss_pred             hheee-eccEEeeEEEecCCcEEEEEc
Confidence            78887 678899999999998877654


No 200
>KOG1273 consensus WD40 repeat protein [General function prediction only]
Probab=98.37  E-value=1e-06  Score=104.11  Aligned_cols=92  Identities=15%  Similarity=0.180  Sum_probs=78.1

Q ss_pred             EEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC
Q 000080         2274 ISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA 2353 (2389)
Q Consensus      2274 V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~ 2353 (2389)
                      -.+++||+.|..||+|..||.|-+||+.|.     .+-+.+.+|-.+|.+++||+ ||+.|.|+   |.|..|++||++.
T Consensus        26 a~~~~Fs~~G~~lAvGc~nG~vvI~D~~T~-----~iar~lsaH~~pi~sl~WS~-dgr~Llts---S~D~si~lwDl~~   96 (405)
T KOG1273|consen   26 AECCQFSRWGDYLAVGCANGRVVIYDFDTF-----RIARMLSAHVRPITSLCWSR-DGRKLLTS---SRDWSIKLWDLLK   96 (405)
T ss_pred             cceEEeccCcceeeeeccCCcEEEEEcccc-----chhhhhhccccceeEEEecC-CCCEeeee---cCCceeEEEeccC
Confidence            689999999999999999999999999985     36677899999999999999 99999997   7999999999963


Q ss_pred             CCCCceEEEEeecCcEEEEeeccc
Q 000080         2354 PPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2354 ~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                        |.+++.+. -..+|+....+|-
T Consensus        97 --gs~l~rir-f~spv~~~q~hp~  117 (405)
T KOG1273|consen   97 --GSPLKRIR-FDSPVWGAQWHPR  117 (405)
T ss_pred             --CCceeEEE-ccCccceeeeccc
Confidence              55777765 4556666555553


No 201
>KOG0974 consensus WD-repeat protein WDR6, WD repeat superfamily [General function prediction only]
Probab=98.37  E-value=1.9e-06  Score=113.02  Aligned_cols=135  Identities=13%  Similarity=0.113  Sum_probs=105.0

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .-+-++++-=++++|+.=+.|.+|++. +.....+         ..||.+.+.++.+|-||+++||.|+|+++|+|++++
T Consensus       137 ~~~g~s~~~~~i~~gsv~~~iivW~~~-~dn~p~~---------l~GHeG~iF~i~~s~dg~~i~s~SdDRsiRlW~i~s  206 (967)
T KOG0974|consen  137 LIIGDSAEELYIASGSVFGEIIVWKPH-EDNKPIR---------LKGHEGSIFSIVTSLDGRYIASVSDDRSIRLWPIDS  206 (967)
T ss_pred             EEEeccCcEEEEEeccccccEEEEecc-ccCCcce---------ecccCCceEEEEEccCCcEEEEEecCcceeeeeccc
Confidence            455678888899999999999999986 3322221         247899999999999999999999999999999998


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC-cEEEEeecccchh
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG-LYDLFLPLKLLNF 2380 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~-~V~svA~~~~~~~ 2380 (2389)
                      +.    ..--+.-||+..|+.+.|.| +  .|+|+|   +|-|.|+|+.   .++.+..+.+|.+ .++.++.++.--+
T Consensus       207 ~~----~~~~~~fgHsaRvw~~~~~~-n--~i~t~g---edctcrvW~~---~~~~l~~y~~h~g~~iw~~~~~~~~~~  272 (967)
T KOG0974|consen  207 RE----VLGCTGFGHSARVWACCFLP-N--RIITVG---EDCTCRVWGV---NGTQLEVYDEHSGKGIWKIAVPIGVII  272 (967)
T ss_pred             cc----ccCcccccccceeEEEEecc-c--eeEEec---cceEEEEEec---ccceehhhhhhhhcceeEEEEcCCceE
Confidence            63    22246678999999999999 4  899984   9999999986   3444556666653 4566666554333


No 202
>KOG0642 consensus Cell-cycle nuclear protein, contains WD-40 repeats [Cell cycle control, cell division, chromosome partitioning]
Probab=98.36  E-value=2.1e-06  Score=107.20  Aligned_cols=155  Identities=14%  Similarity=0.113  Sum_probs=111.7

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEe--cccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATY--GVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl--~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
                      .+|-+|+..+++..+.|||.||+||+|++.... .--++  .++.+   ...||++.|+.+++|+.-.+|+++|.|||||
T Consensus       345 gPVl~v~v~~n~~~~ysgg~Dg~I~~w~~p~n~dp~ds~dp~vl~~---~l~Ghtdavw~l~~s~~~~~Llscs~DgTvr  421 (577)
T KOG0642|consen  345 GPVLCVVVPSNGEHCYSGGIDGTIRCWNLPPNQDPDDSYDPSVLSG---TLLGHTDAVWLLALSSTKDRLLSCSSDGTVR  421 (577)
T ss_pred             CceEEEEecCCceEEEeeccCceeeeeccCCCCCcccccCcchhcc---ceeccccceeeeeecccccceeeecCCceEE
Confidence            367899999999999999999999999654111 10111  01112   2468999999999999999999999999999


Q ss_pred             EeeCCCCCc-------------------c--------------------Ccccceee--ee-----cCCCeeEEEEecCC
Q 000080         2297 TWQLEVGGR-------------------S--------------------NVRPMESC--LC-----FSSHAMDVSYITSS 2330 (2389)
Q Consensus      2297 LWDl~tggr-------------------s--------------------~~k~l~tl--~g-----Hs~~V~sVAFSP~D 2330 (2389)
                      +|+......                   +                    ....+..+  ..     -...++-|..+| .
T Consensus       422 ~w~~~~~~~~~f~~~~e~g~Plsvd~~ss~~a~~~~s~~~~~~~~~~~ev~s~~~~~~s~~~~~~~~~~~in~vVs~~-~  500 (577)
T KOG0642|consen  422 LWEPTEESPCTFGEPKEHGYPLSVDRTSSRPAHSLASFRFGYTSIDDMEVVSDLLIFESSASPGPRRYPQINKVVSHP-T  500 (577)
T ss_pred             eeccCCcCccccCCccccCCcceEeeccchhHhhhhhcccccccchhhhhhhheeeccccCCCcccccCccceEEecC-C
Confidence            997643210                   0                    00000000  00     013455566777 7


Q ss_pred             CCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2331 GSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2331 GslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      +.+..++.   +|+.||+.|.  -+++.+++...|...++++|+.|.|-+..|
T Consensus       501 ~~~~~~~h---ed~~Ir~~dn--~~~~~l~s~~a~~~svtslai~~ng~~l~s  548 (577)
T KOG0642|consen  501 ADITFTAH---EDRSIRFFDN--KTGKILHSMVAHKDSVTSLAIDPNGPYLMS  548 (577)
T ss_pred             CCeeEecc---cCCceecccc--cccccchheeeccceecceeecCCCceEEe
Confidence            77777764   9999999997  467889999999999999999999987665


No 203
>KOG0644 consensus Uncharacterized conserved protein, contains WD40 repeat and BROMO domains [General function prediction only]
Probab=98.35  E-value=1.9e-07  Score=119.17  Aligned_cols=99  Identities=23%  Similarity=0.308  Sum_probs=90.3

Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                      .||.+.|+|+.|.-.|+.+.+||+|.-||+|..+++     .++.++.||++.++++|.+. ...++|++   |.|..||
T Consensus       187 lgH~naVyca~fDrtg~~Iitgsdd~lvKiwS~et~-----~~lAs~rGhs~ditdlavs~-~n~~iaaa---S~D~vIr  257 (1113)
T KOG0644|consen  187 LGHRNAVYCAIFDRTGRYIITGSDDRLVKIWSMETA-----RCLASCRGHSGDITDLAVSS-NNTMIAAA---SNDKVIR  257 (1113)
T ss_pred             HhhhhheeeeeeccccceEeecCccceeeeeeccch-----hhhccCCCCccccchhccch-hhhhhhhc---ccCceEE
Confidence            478899999999999999999999999999999886     57899999999999999998 66788875   7999999


Q ss_pred             EeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2348 VWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2348 LWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      +|..  +.+..+.-|.||++.|+++|++|-
T Consensus       258 vWrl--~~~~pvsvLrghtgavtaiafsP~  285 (1113)
T KOG0644|consen  258 VWRL--PDGAPVSVLRGHTGAVTAIAFSPR  285 (1113)
T ss_pred             EEec--CCCchHHHHhccccceeeeccCcc
Confidence            9997  677778999999999999999884


No 204
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=98.34  E-value=3.6e-06  Score=101.00  Aligned_cols=138  Identities=13%  Similarity=0.057  Sum_probs=102.9

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC------ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD------KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG------k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT 2294 (2389)
                      .|.+|.|+-++++||||++|.++++|++..-      +.+.    +.+|.     |..-|.+++|+.-.+++-||..|+|
T Consensus        58 CiNAlqFS~N~~~L~SGGDD~~~~~W~~de~~~~k~~KPI~----~~~~~-----H~SNIF~L~F~~~N~~~~SG~~~~~  128 (609)
T KOG4227|consen   58 CINALQFSHNDRFLASGGDDMHGRVWNVDELMVRKTPKPIG----VMEHP-----HRSNIFSLEFDLENRFLYSGERWGT  128 (609)
T ss_pred             ccceeeeccCCeEEeecCCcceeeeechHHHHhhcCCCCce----eccCc-----cccceEEEEEccCCeeEecCCCcce
Confidence            4689999999999999999999999998622      2222    23442     6688999999999999999999999


Q ss_pred             EEEeeCCCCCccCcccceeeeecCC---CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC-CCceEEEEeecCcEE
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSS---HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP-TSSRASITCHEGLYD 2370 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~---~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t-g~~v~sL~GH~~~V~ 2370 (2389)
                      |-+-|+++..     .+. ...|..   .|+.+.-+| ..+++|+.   +.|+.|-+||....+ ....-++........
T Consensus       129 VI~HDiEt~q-----si~-V~~~~~~~~~VY~m~~~P-~DN~~~~~---t~~~~V~~~D~Rd~~~~~~~~~~AN~~~~F~  198 (609)
T KOG4227|consen  129 VIKHDIETKQ-----SIY-VANENNNRGDVYHMDQHP-TDNTLIVV---TRAKLVSFIDNRDRQNPISLVLPANSGKNFY  198 (609)
T ss_pred             eEeeecccce-----eee-eecccCcccceeecccCC-CCceEEEE---ecCceEEEEeccCCCCCCceeeecCCCccce
Confidence            9999999852     222 234555   899999999 56778775   699999999985433 222444554555555


Q ss_pred             EEeeccc
Q 000080         2371 LFLPLKL 2377 (2389)
Q Consensus      2371 svA~~~~ 2377 (2389)
                      ++.++|-
T Consensus       199 t~~F~P~  205 (609)
T KOG4227|consen  199 TAEFHPE  205 (609)
T ss_pred             eeeecCC
Confidence            5555553


No 205
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.33  E-value=4.8e-06  Score=100.35  Aligned_cols=112  Identities=20%  Similarity=0.243  Sum_probs=87.2

Q ss_pred             eEEEEEEcCCCCeEEE-Ee-CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-EEE
Q 000080         2221 STRAFSSHPLRPFFLV-GS-SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-VCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LAS-GS-~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-VkL 2297 (2389)
                      ++-++++|+.+.+||- || .-|.|.|||..+=+.+.++.   +       |.+.|.+++|||||++|||||+.|| ||+
T Consensus       131 gl~AlS~n~~n~ylAyp~s~t~GdV~l~d~~nl~~v~~I~---a-------H~~~lAalafs~~G~llATASeKGTVIRV  200 (391)
T KOG2110|consen  131 GLCALSPNNANCYLAYPGSTTSGDVVLFDTINLQPVNTIN---A-------HKGPLAALAFSPDGTLLATASEKGTVIRV  200 (391)
T ss_pred             ceEeeccCCCCceEEecCCCCCceEEEEEcccceeeeEEE---e-------cCCceeEEEECCCCCEEEEeccCceEEEE
Confidence            4566666666678876 33 56899999998777777763   3       6789999999999999999999999 589


Q ss_pred             eeCCCCCccCcccceeeeec--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2298 WQLEVGGRSNVRPMESCLCF--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gH--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ..+..|.     .++.++--  --.|++++|+| |+++|+++   |+-+||.|+.+
T Consensus       201 f~v~~G~-----kl~eFRRG~~~~~IySL~Fs~-ds~~L~~s---S~TeTVHiFKL  247 (391)
T KOG2110|consen  201 FSVPEGQ-----KLYEFRRGTYPVSIYSLSFSP-DSQFLAAS---SNTETVHIFKL  247 (391)
T ss_pred             EEcCCcc-----EeeeeeCCceeeEEEEEEECC-CCCeEEEe---cCCCeEEEEEe
Confidence            9998873     22332211  24577999999 99999986   57889999987


No 206
>KOG1538 consensus Uncharacterized conserved protein WDR10, contains WD40 repeats [General function prediction only]
Probab=98.31  E-value=1.6e-05  Score=99.96  Aligned_cols=193  Identities=16%  Similarity=0.305  Sum_probs=131.0

Q ss_pred             CCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cC
Q 000080           40 STSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA--SE  117 (2389)
Q Consensus        40 ~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yD  117 (2389)
                      ...-+++.||  | +-+.-|+|+-+.++..   ..+ ..+      |.+.||.|  -|-||||+-|    |+..||  +|
T Consensus        14 ci~d~afkPD--G-sqL~lAAg~rlliyD~---ndG-~ll------qtLKgHKD--tVycVAys~d----GkrFASG~aD   74 (1081)
T KOG1538|consen   14 CINDIAFKPD--G-TQLILAAGSRLLVYDT---SDG-TLL------QPLKGHKD--TVYCVAYAKD----GKRFASGSAD   74 (1081)
T ss_pred             chheeEECCC--C-ceEEEecCCEEEEEeC---CCc-ccc------cccccccc--eEEEEEEccC----CceeccCCCc
Confidence            5677899999  7 4677899999999972   223 345      89999999  8999999997    777764  58


Q ss_pred             CeEEEEeeCCCCCCCCccceeeEEe--cccceEEEEeecCCCCeEEEEec-ceEEeeccCCcEEEEEEeeccccceEEEE
Q 000080          118 NCIFVFAHDSASSKGSFCWSQNAIL--VQGTKVEAIEWTGSGDGIVAGGM-ETVLWKKKNTLWEIAWKFKENYPQNLVSA  194 (2389)
Q Consensus       118 ntIRVw~~d~~~~kgd~~W~~~~tL--~hssTV~sIAWSpdG~rLaSggd-DV~IW~~~~s~Wecvwt~~~~~~~~ivsv  194 (2389)
                      +.|-||.+.-   .|        +|  .|+..|.+++|+|....|+||+- |-.+|......   |  .+.....-+.+.
T Consensus        75 K~VI~W~~kl---EG--------~LkYSH~D~IQCMsFNP~~h~LasCsLsdFglWS~~qK~---V--~K~kss~R~~~C  138 (1081)
T KOG1538|consen   75 KSVIIWTSKL---EG--------ILKYSHNDAIQCMSFNPITHQLASCSLSDFGLWSPEQKS---V--SKHKSSSRIICC  138 (1081)
T ss_pred             eeEEEecccc---cc--------eeeeccCCeeeEeecCchHHHhhhcchhhccccChhhhh---H--HhhhhheeEEEe
Confidence            9999998751   12        22  38889999999999999999998 59999743211   1  111122235578


Q ss_pred             eecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEee
Q 000080          195 TWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTC  273 (2389)
Q Consensus       195 aWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILASc  273 (2389)
                      +|.-||. ||-+-++....+.+... .+.+-|.          -..+-..+|.+|+|+|.+     +   ....++++-.
T Consensus       139 sWtnDGqylalG~~nGTIsiRNk~g-Eek~~I~----------Rpgg~Nspiwsi~~~p~s-----g---~G~~di~aV~  199 (1081)
T KOG1538|consen  139 SWTNDGQYLALGMFNGTISIRNKNG-EEKVKIE----------RPGGSNSPIWSICWNPSS-----G---EGRNDILAVA  199 (1081)
T ss_pred             eecCCCcEEEEeccCceEEeecCCC-CcceEEe----------CCCCCCCCceEEEecCCC-----C---CCccceEEEE
Confidence            9999999 88876644422221100 0111111          123455899999999942     2   2345777777


Q ss_pred             ecCCeEEEEEeec
Q 000080          274 CLDGTVRLWCEMD  286 (2389)
Q Consensus       274 SdDgTVRLW~e~d  286 (2389)
                      --..|.-.+...+
T Consensus       200 DW~qTLSFy~LsG  212 (1081)
T KOG1538|consen  200 DWGQTLSFYQLSG  212 (1081)
T ss_pred             eccceeEEEEecc
Confidence            7777777777654


No 207
>KOG2048 consensus WD40 repeat protein [General function prediction only]
Probab=98.31  E-value=8.5e-06  Score=103.49  Aligned_cols=145  Identities=11%  Similarity=0.113  Sum_probs=116.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|+++||+.+.+.||.|=.||.|.||++..+.+....  ++|+      ....|.+++|+ +|.+|-|.+.+|+|.-||+
T Consensus        27 ~I~slA~s~kS~~lAvsRt~g~IEiwN~~~~w~~~~v--i~g~------~drsIE~L~W~-e~~RLFS~g~sg~i~EwDl   97 (691)
T KOG2048|consen   27 EIVSLAYSHKSNQLAVSRTDGNIEIWNLSNNWFLEPV--IHGP------EDRSIESLAWA-EGGRLFSSGLSGSITEWDL   97 (691)
T ss_pred             ceEEEEEeccCCceeeeccCCcEEEEccCCCceeeEE--EecC------CCCceeeEEEc-cCCeEEeecCCceEEEEec
Confidence            4699999999999999999999999999999865543  2332      34679999999 6668889999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeecCcEEEEeecccc
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      .++     ++.+.+.+..+.++++|.+| .++.+|-+   ++||.+..-+.  .++...  ..|.-.+++|-+|+.+|+|
T Consensus        98 ~~l-----k~~~~~d~~gg~IWsiai~p-~~~~l~Ig---cddGvl~~~s~--~p~~I~~~r~l~rq~sRvLslsw~~~~  166 (691)
T KOG2048|consen   98 HTL-----KQKYNIDSNGGAIWSIAINP-ENTILAIG---CDDGVLYDFSI--GPDKITYKRSLMRQKSRVLSLSWNPTG  166 (691)
T ss_pred             ccC-----ceeEEecCCCcceeEEEeCC-ccceEEee---cCCceEEEEec--CCceEEEEeecccccceEEEEEecCCc
Confidence            986     57788888999999999999 77888874   69996555554  444442  4567677889999999998


Q ss_pred             hhhhccc
Q 000080         2379 NFALSKC 2385 (2389)
Q Consensus      2379 ~~~~s~~ 2385 (2389)
                      -.+..-|
T Consensus       167 ~~i~~Gs  173 (691)
T KOG2048|consen  167 TKIAGGS  173 (691)
T ss_pred             cEEEecc
Confidence            8666554


No 208
>KOG2110 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=98.30  E-value=1.1e-05  Score=97.50  Aligned_cols=140  Identities=15%  Similarity=0.133  Sum_probs=107.6

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--CCCcEEEe
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA--LDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS--~DgTVkLW 2298 (2389)
                      +|-+|.++.  +.|+..=.+. |+|+|+.+=+.+.|+...|.       |-..+.++.+++.+.++|-=+  .-|.|.||
T Consensus        89 ~IL~VrmNr--~RLvV~Lee~-IyIydI~~MklLhTI~t~~~-------n~~gl~AlS~n~~n~ylAyp~s~t~GdV~l~  158 (391)
T KOG2110|consen   89 SILAVRMNR--KRLVVCLEES-IYIYDIKDMKLLHTIETTPP-------NPKGLCALSPNNANCYLAYPGSTTSGDVVLF  158 (391)
T ss_pred             ceEEEEEcc--ceEEEEEccc-EEEEecccceeehhhhccCC-------CccceEeeccCCCCceEEecCCCCCceEEEE
Confidence            346666665  4466655554 99999998888888753222       235688888888888888633  35899999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe-EEEeeCCCCCCCceEEEEee--cCcEEEEeec
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN-VVVWDTLAPPTSSRASITCH--EGLYDLFLPL 2375 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T-VrLWD~l~~tg~~v~sL~GH--~~~V~svA~~ 2375 (2389)
                      |+.+-     +++.++.+|.+.+.++||+| ||.+||||   |+.|| ||+..+  +.|+.++.|.--  .-.|.+++|+
T Consensus       159 d~~nl-----~~v~~I~aH~~~lAalafs~-~G~llATA---SeKGTVIRVf~v--~~G~kl~eFRRG~~~~~IySL~Fs  227 (391)
T KOG2110|consen  159 DTINL-----QPVNTINAHKGPLAALAFSP-DGTLLATA---SEKGTVIRVFSV--PEGQKLYEFRRGTYPVSIYSLSFS  227 (391)
T ss_pred             Ecccc-----eeeeEEEecCCceeEEEECC-CCCEEEEe---ccCceEEEEEEc--CCccEeeeeeCCceeeEEEEEEEC
Confidence            99863     78899999999999999999 99999998   45555 899998  778888777433  3456699999


Q ss_pred             ccchhh
Q 000080         2376 KLLNFA 2381 (2389)
Q Consensus      2376 ~~~~~~ 2381 (2389)
                      |++.|.
T Consensus       228 ~ds~~L  233 (391)
T KOG2110|consen  228 PDSQFL  233 (391)
T ss_pred             CCCCeE
Confidence            999864


No 209
>PRK03629 tolB translocation protein TolB; Provisional
Probab=98.30  E-value=6.3e-06  Score=103.25  Aligned_cols=140  Identities=9%  Similarity=0.040  Sum_probs=92.3

Q ss_pred             EEEEEcCCCCeEEEE-eCCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-CcEEEe
Q 000080         2223 RAFSSHPLRPFFLVG-SSNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-GTVCTW 2298 (2389)
Q Consensus      2223 rsVAFsPdG~~LASG-S~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-gTVkLW 2298 (2389)
                      .+++|+|||+.|+.. +.++  .|++||+.+|+..+...           +...+...+|||||+.|+.++.+ +..+||
T Consensus       246 ~~~~~SPDG~~La~~~~~~g~~~I~~~d~~tg~~~~lt~-----------~~~~~~~~~wSPDG~~I~f~s~~~g~~~Iy  314 (429)
T PRK03629        246 GAPAFSPDGSKLAFALSKTGSLNLYVMDLASGQIRQVTD-----------GRSNNTEPTWFPDSQNLAYTSDQAGRPQVY  314 (429)
T ss_pred             CCeEECCCCCEEEEEEcCCCCcEEEEEECCCCCEEEccC-----------CCCCcCceEECCCCCEEEEEeCCCCCceEE
Confidence            346899999988754 4444  59999998887543221           12457889999999999888865 556666


Q ss_pred             --eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2299 --QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2299 --Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                        |+.++.      ...+..+.......+|+| ||+.||.++....+..|.+||+  .+++ .+.|.. .......+++|
T Consensus       315 ~~d~~~g~------~~~lt~~~~~~~~~~~Sp-DG~~Ia~~~~~~g~~~I~~~dl--~~g~-~~~Lt~-~~~~~~p~~Sp  383 (429)
T PRK03629        315 KVNINGGA------PQRITWEGSQNQDADVSS-DGKFMVMVSSNGGQQHIAKQDL--ATGG-VQVLTD-TFLDETPSIAP  383 (429)
T ss_pred             EEECCCCC------eEEeecCCCCccCEEECC-CCCEEEEEEccCCCceEEEEEC--CCCC-eEEeCC-CCCCCCceECC
Confidence              555441      223333444566789999 9999988652223356888997  3333 455542 22234677889


Q ss_pred             cchhhhcc
Q 000080         2377 LLNFALSK 2384 (2389)
Q Consensus      2377 ~~~~~~s~ 2384 (2389)
                      +|++++.-
T Consensus       384 DG~~i~~~  391 (429)
T PRK03629        384 NGTMVIYS  391 (429)
T ss_pred             CCCEEEEE
Confidence            99987653


No 210
>KOG0771 consensus Prolactin regulatory element-binding protein/Protein transport protein SEC12p [Intracellular trafficking, secretion, and vesicular transport]
Probab=98.29  E-value=1.9e-06  Score=104.90  Aligned_cols=151  Identities=16%  Similarity=0.158  Sum_probs=105.5

Q ss_pred             ccccccceeeccccccccccccc------cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEec----
Q 000080         2189 PGYAGIGASALGWETQDDFEDYV------DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYG---- 2258 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~------d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~---- 2258 (2389)
                      .|.+..+|.| |-|..-|+|++-      +..++-  -.|..++|+|||++|||-+.| ..++|++.+|-+++...    
T Consensus       153 ~~~gs~latg-g~dg~lRv~~~Ps~~t~l~e~~~~--~eV~DL~FS~dgk~lasig~d-~~~VW~~~~g~~~a~~t~~~k  228 (398)
T KOG0771|consen  153 NGDGSKLATG-GTDGTLRVWEWPSMLTILEEIAHH--AEVKDLDFSPDGKFLASIGAD-SARVWSVNTGAALARKTPFSK  228 (398)
T ss_pred             cCCCCEeeec-cccceEEEEecCcchhhhhhHhhc--CccccceeCCCCcEEEEecCC-ceEEEEeccCchhhhcCCccc
Confidence            3444556666 667777777652      111221  256899999999999999999 89999999994332221    


Q ss_pred             ----------------------c-cCCCCCC------CCC-----------CCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2259 ----------------------V-LPAANVP------PPY-----------ALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2259 ----------------------v-l~gh~~p------~~G-----------H~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                                            . .|+..+.      .-+           -...|++++.|+||+++|-|+.||.|-+.
T Consensus       229 ~~~~~~cRF~~d~~~~~l~laa~~~~~~~v~~~~~~~w~~~~~l~~~~~~~~~~siSsl~VS~dGkf~AlGT~dGsVai~  308 (398)
T KOG0771|consen  229 DEMFSSCRFSVDNAQETLRLAASQFPGGGVRLCDISLWSGSNFLRLRKKIKRFKSISSLAVSDDGKFLALGTMDGSVAIY  308 (398)
T ss_pred             chhhhhceecccCCCceEEEEEecCCCCceeEEEeeeeccccccchhhhhhccCcceeEEEcCCCcEEEEeccCCcEEEE
Confidence                                  0 0111000      000           01469999999999999999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ++.+-.    .....-+.|...|.+|+|+| |.+.+++.   |.|.++.|--+
T Consensus       309 ~~~~lq----~~~~vk~aH~~~VT~ltF~P-dsr~~~sv---Ss~~~~~v~~l  353 (398)
T KOG0771|consen  309 DAKSLQ----RLQYVKEAHLGFVTGLTFSP-DSRYLASV---SSDNEAAVTKL  353 (398)
T ss_pred             Eeceee----eeEeehhhheeeeeeEEEcC-CcCccccc---ccCCceeEEEE
Confidence            998642    22333467999999999999 88999985   57777777665


No 211
>KOG0322 consensus G-protein beta subunit-like protein GNB1L, contains WD repeats [General function prediction only]
Probab=98.28  E-value=1.4e-06  Score=101.37  Aligned_cols=113  Identities=13%  Similarity=0.207  Sum_probs=92.1

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC--ce-eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD--KA-TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG--k~-l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      +|.++.|.+.-..=++|+.|-.+-.|.+...  .+ ++....+        .| ..|..|.+-|||+.||||++|+.||+
T Consensus       207 pvlsldyas~~~rGisgga~dkl~~~Sl~~s~gslq~~~e~~l--------kn-pGv~gvrIRpD~KIlATAGWD~RiRV  277 (323)
T KOG0322|consen  207 PVLSLDYASSCDRGISGGADDKLVMYSLNHSTGSLQIRKEITL--------KN-PGVSGVRIRPDGKILATAGWDHRIRV  277 (323)
T ss_pred             cceeeeechhhcCCcCCCccccceeeeeccccCcccccceEEe--------cC-CCccceEEccCCcEEeecccCCcEEE
Confidence            6788899987777789999999999997643  32 1111100        11 44899999999999999999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +.-++.     +|+.-+.-|++.|++|||+| |..++|+|   |.|.+|-||++
T Consensus       278 yswrtl-----~pLAVLkyHsagvn~vAfsp-d~~lmAaa---skD~rISLWkL  322 (323)
T KOG0322|consen  278 YSWRTL-----NPLAVLKYHSAGVNAVAFSP-DCELMAAA---SKDARISLWKL  322 (323)
T ss_pred             EEeccC-----CchhhhhhhhcceeEEEeCC-CCchhhhc---cCCceEEeeec
Confidence            999986     57888888999999999999 77999987   69999999985


No 212
>PRK05137 tolB translocation protein TolB; Provisional
Probab=98.26  E-value=7.2e-06  Score=102.52  Aligned_cols=138  Identities=12%  Similarity=0.001  Sum_probs=92.1

Q ss_pred             EEEEEcCCCCeEE-EEeCCCc--EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CC--cEE
Q 000080         2223 RAFSSHPLRPFFL-VGSSNTH--IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DG--TVC 2296 (2389)
Q Consensus      2223 rsVAFsPdG~~LA-SGS~DgT--IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-Dg--TVk 2296 (2389)
                      .+.+|+|||+.|+ +.+.|+.  |++||+.+++..+ +.   .       +...++..+|||||++||.++. +|  .|.
T Consensus       249 ~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~~~~-Lt---~-------~~~~~~~~~~spDG~~i~f~s~~~g~~~Iy  317 (435)
T PRK05137        249 FAPRFSPDGRKVVMSLSQGGNTDIYTMDLRSGTTTR-LT---D-------SPAIDTSPSYSPDGSQIVFESDRSGSPQLY  317 (435)
T ss_pred             cCcEECCCCCEEEEEEecCCCceEEEEECCCCceEE-cc---C-------CCCccCceeEcCCCCEEEEEECCCCCCeEE
Confidence            4568999999765 5566655  7788988776533 32   1       2244677899999999998874 33  577


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      +||+.++.      ...+..+...+...+|+| ||+.||.......+..|.+||+   .++..+.+. +...+...+++|
T Consensus       318 ~~d~~g~~------~~~lt~~~~~~~~~~~Sp-dG~~ia~~~~~~~~~~i~~~d~---~~~~~~~lt-~~~~~~~p~~sp  386 (435)
T PRK05137        318 VMNADGSN------PRRISFGGGRYSTPVWSP-RGDLIAFTKQGGGQFSIGVMKP---DGSGERILT-SGFLVEGPTWAP  386 (435)
T ss_pred             EEECCCCC------eEEeecCCCcccCeEECC-CCCEEEEEEcCCCceEEEEEEC---CCCceEecc-CCCCCCCCeECC
Confidence            77887542      233333445566788999 9999987643223357888886   233444443 233567888999


Q ss_pred             cchhhh
Q 000080         2377 LLNFAL 2382 (2389)
Q Consensus      2377 ~~~~~~ 2382 (2389)
                      +|++++
T Consensus       387 DG~~i~  392 (435)
T PRK05137        387 NGRVIM  392 (435)
T ss_pred             CCCEEE
Confidence            999865


No 213
>PRK00178 tolB translocation protein TolB; Provisional
Probab=98.25  E-value=1.4e-05  Score=99.30  Aligned_cols=139  Identities=9%  Similarity=0.001  Sum_probs=90.5

Q ss_pred             eEEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEE-EEeCCC--c
Q 000080         2221 STRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFA-SAALDG--T 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LA-SgS~Dg--T 2294 (2389)
                      .+.+.+|+|||+.||..+.+   ..|.+||+.+|+..+... .+          +.+.+.+|||||++|| +.+.+|  .
T Consensus       200 ~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~~~l~~-~~----------g~~~~~~~SpDG~~la~~~~~~g~~~  268 (430)
T PRK00178        200 PILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRREQITN-FE----------GLNGAPAWSPDGSKLAFVLSKDGNPE  268 (430)
T ss_pred             ceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCEEEccC-CC----------CCcCCeEECCCCCEEEEEEccCCCce
Confidence            34778999999999887754   469999998887543211 11          2345789999999988 455555  5


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      |.+||++++.      ...+..+.....+.+|+| ||+.|+..+  ..++  .|.++|+  .+++ +..+..........
T Consensus       269 Iy~~d~~~~~------~~~lt~~~~~~~~~~~sp-Dg~~i~f~s--~~~g~~~iy~~d~--~~g~-~~~lt~~~~~~~~~  336 (430)
T PRK00178        269 IYVMDLASRQ------LSRVTNHPAIDTEPFWGK-DGRTLYFTS--DRGGKPQIYKVNV--NGGR-AERVTFVGNYNARP  336 (430)
T ss_pred             EEEEECCCCC------eEEcccCCCCcCCeEECC-CCCEEEEEE--CCCCCceEEEEEC--CCCC-EEEeecCCCCccce
Confidence            7777998752      233445555666789999 899887653  2333  4666665  3444 33333222223456


Q ss_pred             eecccchhhh
Q 000080         2373 LPLKLLNFAL 2382 (2389)
Q Consensus      2373 A~~~~~~~~~ 2382 (2389)
                      +.+|+|++++
T Consensus       337 ~~Spdg~~i~  346 (430)
T PRK00178        337 RLSADGKTLV  346 (430)
T ss_pred             EECCCCCEEE
Confidence            7788888764


No 214
>PRK04922 tolB translocation protein TolB; Provisional
Probab=98.23  E-value=8.3e-06  Score=102.00  Aligned_cols=139  Identities=17%  Similarity=0.071  Sum_probs=89.6

Q ss_pred             EEEEEcCCCCeEE-EEeCCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCc--EE
Q 000080         2223 RAFSSHPLRPFFL-VGSSNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGT--VC 2296 (2389)
Q Consensus      2223 rsVAFsPdG~~LA-SGS~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgT--Vk 2296 (2389)
                      .+.+|+|||+.|+ +.+.++  .|++||+.+|+..+ +.   .       |......++|+|||++|+.++. +|.  |.
T Consensus       251 ~~~~~SpDG~~l~~~~s~~g~~~Iy~~d~~~g~~~~-lt---~-------~~~~~~~~~~spDG~~l~f~sd~~g~~~iy  319 (433)
T PRK04922        251 GAPSFSPDGRRLALTLSRDGNPEIYVMDLGSRQLTR-LT---N-------HFGIDTEPTWAPDGKSIYFTSDRGGRPQIY  319 (433)
T ss_pred             cCceECCCCCEEEEEEeCCCCceEEEEECCCCCeEE-Cc---c-------CCCCccceEECCCCCEEEEEECCCCCceEE
Confidence            3568999999765 555555  69999998887543 22   1       2234567899999999998874 455  55


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ++|+.++.      ...+.-+......++|+| ||+.||.......+..|.+||+  .+++ .+.|. +.......+.+|
T Consensus       320 ~~dl~~g~------~~~lt~~g~~~~~~~~Sp-DG~~Ia~~~~~~~~~~I~v~d~--~~g~-~~~Lt-~~~~~~~p~~sp  388 (433)
T PRK04922        320 RVAASGGS------AERLTFQGNYNARASVSP-DGKKIAMVHGSGGQYRIAVMDL--STGS-VRTLT-PGSLDESPSFAP  388 (433)
T ss_pred             EEECCCCC------eEEeecCCCCccCEEECC-CCCEEEEEECCCCceeEEEEEC--CCCC-eEECC-CCCCCCCceECC
Confidence            55666542      122222333445689999 9999987532122346999997  3333 34454 333455778999


Q ss_pred             cchhhhc
Q 000080         2377 LLNFALS 2383 (2389)
Q Consensus      2377 ~~~~~~s 2383 (2389)
                      +|++++-
T Consensus       389 dG~~i~~  395 (433)
T PRK04922        389 NGSMVLY  395 (433)
T ss_pred             CCCEEEE
Confidence            9998753


No 215
>PRK04792 tolB translocation protein TolB; Provisional
Probab=98.21  E-value=1.5e-05  Score=100.63  Aligned_cols=140  Identities=10%  Similarity=0.018  Sum_probs=88.9

Q ss_pred             EEEEEEcCCCCeEEEEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCCc--E
Q 000080         2222 TRAFSSHPLRPFFLVGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDGT--V 2295 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~DgT--V 2295 (2389)
                      +.+.+|+|||+.|+..+.+   ..|++||+.+|+... +...+          ....+.+|||||+.||. .+.||.  |
T Consensus       220 ~~~p~wSPDG~~La~~s~~~g~~~L~~~dl~tg~~~~-lt~~~----------g~~~~~~wSPDG~~La~~~~~~g~~~I  288 (448)
T PRK04792        220 LMSPAWSPDGRKLAYVSFENRKAEIFVQDIYTQVREK-VTSFP----------GINGAPRFSPDGKKLALVLSKDGQPEI  288 (448)
T ss_pred             ccCceECCCCCEEEEEEecCCCcEEEEEECCCCCeEE-ecCCC----------CCcCCeeECCCCCEEEEEEeCCCCeEE
Confidence            4667999999998877643   258999998887532 21111          12346899999998875 566675  6


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      .+||++++.      ...+..+.......+|+| ||+.|+.++  ..++..+||.+...+++ ...+..+.......+.+
T Consensus       289 y~~dl~tg~------~~~lt~~~~~~~~p~wSp-DG~~I~f~s--~~~g~~~Iy~~dl~~g~-~~~Lt~~g~~~~~~~~S  358 (448)
T PRK04792        289 YVVDIATKA------LTRITRHRAIDTEPSWHP-DGKSLIFTS--ERGGKPQIYRVNLASGK-VSRLTFEGEQNLGGSIT  358 (448)
T ss_pred             EEEECCCCC------eEECccCCCCccceEECC-CCCEEEEEE--CCCCCceEEEEECCCCC-EEEEecCCCCCcCeeEC
Confidence            677887652      234444555667899999 999888753  23444445443223343 44443222223456889


Q ss_pred             ccchhhh
Q 000080         2376 KLLNFAL 2382 (2389)
Q Consensus      2376 ~~~~~~~ 2382 (2389)
                      |+|++++
T Consensus       359 pDG~~l~  365 (448)
T PRK04792        359 PDGRSMI  365 (448)
T ss_pred             CCCCEEE
Confidence            9998753


No 216
>KOG1524 consensus WD40 repeat-containing protein CHE-2 [General function prediction only]
Probab=98.19  E-value=4.4e-06  Score=103.45  Aligned_cols=139  Identities=12%  Similarity=0.120  Sum_probs=108.8

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|.+-.|+|||.=|+|+++||.||+|. ++|-+..|+.+          ....|+|+++.|+.+.+.-+-.| .+.+=-+
T Consensus       106 A~~~gRW~~dGtgLlt~GEDG~iKiWS-rsGMLRStl~Q----------~~~~v~c~~W~p~S~~vl~c~g~-h~~IKpL  173 (737)
T KOG1524|consen  106 AISSGRWSPDGAGLLTAGEDGVIKIWS-RSGMLRSTVVQ----------NEESIRCARWAPNSNSIVFCQGG-HISIKPL  173 (737)
T ss_pred             hhhhcccCCCCceeeeecCCceEEEEe-ccchHHHHHhh----------cCceeEEEEECCCCCceEEecCC-eEEEeec
Confidence            345668999999999999999999999 57866655531          12569999999998766655443 3444333


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      ...     .....+.+|.+-|.++.|+| ...+|||||   +|-.-||||-   .|..+..=+.|+-+|++||+-|+-.|
T Consensus       174 ~~n-----~k~i~WkAHDGiiL~~~W~~-~s~lI~sgG---ED~kfKvWD~---~G~~Lf~S~~~ey~ITSva~npd~~~  241 (737)
T KOG1524|consen  174 AAN-----SKIIRWRAHDGLVLSLSWST-QSNIIASGG---EDFRFKIWDA---QGANLFTSAAEEYAITSVAFNPEKDY  241 (737)
T ss_pred             ccc-----cceeEEeccCcEEEEeecCc-cccceeecC---CceeEEeecc---cCcccccCChhccceeeeeeccccce
Confidence            321     23456789999999999999 789999985   9999999995   57777777789999999999999988


Q ss_pred             hhc
Q 000080         2381 ALS 2383 (2389)
Q Consensus      2381 ~~s 2383 (2389)
                      ||-
T Consensus       242 ~v~  244 (737)
T KOG1524|consen  242 LLW  244 (737)
T ss_pred             eee
Confidence            873


No 217
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=98.19  E-value=3.6e-06  Score=102.25  Aligned_cols=119  Identities=8%  Similarity=0.050  Sum_probs=91.2

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      ++.+...........++++..+.+|....|.+...           .||...|+.|++|||++++.+++.|..||+=..-
T Consensus       113 i~~~~~~~sv~v~dkagD~~~~di~s~~~~~~~~~-----------lGhvSml~dVavS~D~~~IitaDRDEkIRvs~yp  181 (390)
T KOG3914|consen  113 ISFIREDTSVLVADKAGDVYSFDILSADSGRCEPI-----------LGHVSMLLDVAVSPDDQFIITADRDEKIRVSRYP  181 (390)
T ss_pred             eeeeeccceEEEEeecCCceeeeeecccccCcchh-----------hhhhhhhheeeecCCCCEEEEecCCceEEEEecC
Confidence            35566666666666778888888888866665444           4789999999999999999999999999975433


Q ss_pred             CCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2302 VGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2302 tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      ..     ..+.+ +.||...|..++.-+  ++.|+||   |.|+|||+||+  .++++++++.
T Consensus       182 a~-----f~IesfclGH~eFVS~isl~~--~~~LlS~---sGD~tlr~Wd~--~sgk~L~t~d  232 (390)
T KOG3914|consen  182 AT-----FVIESFCLGHKEFVSTISLTD--NYLLLSG---SGDKTLRLWDI--TSGKLLDTCD  232 (390)
T ss_pred             cc-----cchhhhccccHhheeeeeecc--Cceeeec---CCCCcEEEEec--ccCCcccccc
Confidence            21     22333 468999999999997  5778886   48999999998  5777776654


No 218
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=98.18  E-value=3.4e-05  Score=92.99  Aligned_cols=151  Identities=21%  Similarity=0.349  Sum_probs=99.4

Q ss_pred             CCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccc---cccccceeeeeccCCCCCeeEEEEcCCCCCCCcEE-
Q 000080           38 TRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEA---LIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLA-  113 (2389)
Q Consensus        38 ~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~---~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIa-  113 (2389)
                      -|.+..++|-|-  +..-+|.|--..+-|-..+. ..+-.+   .-+.-=-|++.+.+| .+|++.+|.||   ++.++ 
T Consensus       140 QrnvtclawRPl--saselavgCr~gIciW~~s~-tln~~r~~~~~s~~~~qvl~~pgh-~pVtsmqwn~d---gt~l~t  212 (445)
T KOG2139|consen  140 QRNVTCLAWRPL--SASELAVGCRAGICIWSDSR-TLNANRNIRMMSTHHLQVLQDPGH-NPVTSMQWNED---GTILVT  212 (445)
T ss_pred             hcceeEEEeccC--CcceeeeeecceeEEEEcCc-ccccccccccccccchhheeCCCC-ceeeEEEEcCC---CCEEee
Confidence            366778999986  33455555555555544322 222111   001111277777666 59999999998   66666 


Q ss_pred             Eec-CCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeecccc
Q 000080          114 AAS-ENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYP  188 (2389)
Q Consensus       114 ASy-DntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~  188 (2389)
                      ||+ |..|+||.++.+         ....|.  .-+-+.-+.|||||+.|.++..|  -++|+....-|..=|-+.   +
T Consensus       213 AS~gsssi~iWdpdtg---------~~~pL~~~glgg~slLkwSPdgd~lfaAt~davfrlw~e~q~wt~erw~lg---s  280 (445)
T KOG2139|consen  213 ASFGSSSIMIWDPDTG---------QKIPLIPKGLGGFSLLKWSPDGDVLFAATCDAVFRLWQENQSWTKERWILG---S  280 (445)
T ss_pred             cccCcceEEEEcCCCC---------CcccccccCCCceeeEEEcCCCCEEEEecccceeeeehhcccceecceecc---C
Confidence            565 589999999821         111222  34567789999999999988887  789988777777777543   2


Q ss_pred             ceEEEEeecCCCc--eEeeec
Q 000080          189 QNLVSATWSIEGP--SATAAS  207 (2389)
Q Consensus       189 ~~ivsvaWSpdG~--fATag~  207 (2389)
                      ..+-..-|+|+|.  +-+|++
T Consensus       281 grvqtacWspcGsfLLf~~sg  301 (445)
T KOG2139|consen  281 GRVQTACWSPCGSFLLFACSG  301 (445)
T ss_pred             CceeeeeecCCCCEEEEEEcC
Confidence            3455778999998  666666


No 219
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.16  E-value=0.00011  Score=92.70  Aligned_cols=200  Identities=14%  Similarity=0.160  Sum_probs=104.0

Q ss_pred             cceeecCCCCCCeE--EEEecCCc-EEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEec--
Q 000080           42 STIDWLPDFAGYSW--VAYGASSL-LVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAAS--  116 (2389)
Q Consensus        42 ~ai~wlpD~~G~~~--vAYasg~~-vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASy--  116 (2389)
                      ..+.|+||.+++.+  ++|..|.. |.+..+..   + +..      ++-...+   .....+||||   +..||...  
T Consensus       188 ~sP~wSPDG~~~~~~y~S~~~g~~~I~~~~l~~---g-~~~------~lt~~~g---~~~~p~wSPD---G~~Laf~s~~  251 (428)
T PRK01029        188 ITPTWMHIGSGFPYLYVSYKLGVPKIFLGSLEN---P-AGK------KILALQG---NQLMPTFSPR---KKLLAFISDR  251 (428)
T ss_pred             ccceEccCCCceEEEEEEccCCCceEEEEECCC---C-Cce------EeecCCC---CccceEECCC---CCEEEEEECC
Confidence            46799999655423  45555543 44445432   3 211      2322222   2556899999   66777433  


Q ss_pred             CCeEEE----EeeCCCCCCCCccceeeEEec-c-cceEEEEeecCCCCeEEEEecc---eEEeecc----CCcEEEEEEe
Q 000080          117 ENCIFV----FAHDSASSKGSFCWSQNAILV-Q-GTKVEAIEWTGSGDGIVAGGME---TVLWKKK----NTLWEIAWKF  183 (2389)
Q Consensus       117 DntIRV----w~~d~~~~kgd~~W~~~~tL~-h-ssTV~sIAWSpdG~rLaSggdD---V~IW~~~----~s~Wecvwt~  183 (2389)
                      ++.-.+    |..+.. ..+.     ...++ . ...+...+|+|||++|+..++.   .+||...    .+.-+.+   
T Consensus       252 ~g~~di~~~~~~~~~g-~~g~-----~~~lt~~~~~~~~~p~wSPDG~~Laf~s~~~g~~~ly~~~~~~~g~~~~~l---  322 (428)
T PRK01029        252 YGNPDLFIQSFSLETG-AIGK-----PRRLLNEAFGTQGNPSFSPDGTRLVFVSNKDGRPRIYIMQIDPEGQSPRLL---  322 (428)
T ss_pred             CCCcceeEEEeecccC-CCCc-----ceEeecCCCCCcCCeEECCCCCEEEEEECCCCCceEEEEECcccccceEEe---
Confidence            222223    332210 0011     11222 2 2345678999999999977752   5677532    1111222   


Q ss_pred             eccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCC
Q 000080          184 KENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDT  262 (2389)
Q Consensus       184 ~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dg  262 (2389)
                      . .+...+...+|||||. +|.++....         ..-++++..++.. . .........+....|+|        ||
T Consensus       323 t-~~~~~~~~p~wSPDG~~Laf~~~~~g---------~~~I~v~dl~~g~-~-~~Lt~~~~~~~~p~wSp--------DG  382 (428)
T PRK01029        323 T-KKYRNSSCPAWSPDGKKIAFCSVIKG---------VRQICVYDLATGR-D-YQLTTSPENKESPSWAI--------DS  382 (428)
T ss_pred             c-cCCCCccceeECCCCCEEEEEEcCCC---------CcEEEEEECCCCC-e-EEccCCCCCccceEECC--------CC
Confidence            1 1223445679999999 887765311         1235555333222 1 12222345678899999        66


Q ss_pred             ccccCceEEeeecCCeEEEEEee-cCCcc
Q 000080          263 KRSQRHVLLTCCLDGTVRLWCEM-DSGKT  290 (2389)
Q Consensus       263 k~~~~nILAScSdDgTVRLW~e~-d~Gk~  290 (2389)
                      +.    |+.++..++.-.||... +.|+.
T Consensus       383 ~~----L~f~~~~~g~~~L~~vdl~~g~~  407 (428)
T PRK01029        383 LH----LVYSAGNSNESELYLISLITKKT  407 (428)
T ss_pred             CE----EEEEECCCCCceEEEEECCCCCE
Confidence            66    44566666655666544 33444


No 220
>KOG2139 consensus WD40 repeat protein [General function prediction only]
Probab=98.16  E-value=2.9e-05  Score=93.50  Aligned_cols=186  Identities=16%  Similarity=0.232  Sum_probs=109.4

Q ss_pred             EEEecCCcEEEEeCCCCcccccccccccceeeeec-cCCCCCeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCc
Q 000080           56 VAYGASSLLVISHFPSPLSQEEALIGPIFRQVFAL-SDNSLPVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSF  134 (2389)
Q Consensus        56 vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qvieg-h~d~~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~  134 (2389)
                      .|.|..+++|...  +-.+.  +.      .++.. ++  .+|+|++|-|-  +..+++.++-..|++|..+...+.+..
T Consensus       113 fava~nddvVriy--~ksst--~p------t~Lks~sQ--rnvtclawRPl--saselavgCr~gIciW~~s~tln~~r~  178 (445)
T KOG2139|consen  113 FAVATNDDVVRIY--DKSST--CP------TKLKSVSQ--RNVTCLAWRPL--SASELAVGCRAGICIWSDSRTLNANRN  178 (445)
T ss_pred             hhhhccCcEEEEe--ccCCC--CC------ceecchhh--cceeEEEeccC--CcceeeeeecceeEEEEcCcccccccc
Confidence            4666667777666  21111  12      23332 22  37999999996  556788888889999988742111110


Q ss_pred             ----cceeeEEec--ccceEEEEeecCCCCeEEEEecc---eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc--eE
Q 000080          135 ----CWSQNAILV--QGTKVEAIEWTGSGDGIVAGGME---TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP--SA  203 (2389)
Q Consensus       135 ----~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdD---V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~--fA  203 (2389)
                          .=.+.+.+.  ..-.|.+++|++||.+|++++.+   +.||+-..+...-+   ...+...+--..|||||.  ||
T Consensus       179 ~~~~s~~~~qvl~~pgh~pVtsmqwn~dgt~l~tAS~gsssi~iWdpdtg~~~pL---~~~glgg~slLkwSPdgd~lfa  255 (445)
T KOG2139|consen  179 IRMMSTHHLQVLQDPGHNPVTSMQWNEDGTILVTASFGSSSIMIWDPDTGQKIPL---IPKGLGGFSLLKWSPDGDVLFA  255 (445)
T ss_pred             cccccccchhheeCCCCceeeEEEEcCCCCEEeecccCcceEEEEcCCCCCcccc---cccCCCceeeEEEcCCCCEEEE
Confidence                112333443  35689999999999999999997   99999665554322   112223332348999998  55


Q ss_pred             eeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEE
Q 000080          204 TAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWC  283 (2389)
Q Consensus       204 Tag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~  283 (2389)
                      +... ..|..|...+    .|..        +.. -.-++.|..-.|+|        +|+.    +|.+|+.  .=+|+.
T Consensus       256 At~d-avfrlw~e~q----~wt~--------erw-~lgsgrvqtacWsp--------cGsf----LLf~~sg--sp~lys  307 (445)
T KOG2139|consen  256 ATCD-AVFRLWQENQ----SWTK--------ERW-ILGSGRVQTACWSP--------CGSF----LLFACSG--SPRLYS  307 (445)
T ss_pred             eccc-ceeeeehhcc----ccee--------cce-eccCCceeeeeecC--------CCCE----EEEEEcC--CceEEE
Confidence            4433 2234441111    0100        000 12345788889999        5555    6777764  456666


Q ss_pred             eec
Q 000080          284 EMD  286 (2389)
Q Consensus       284 e~d  286 (2389)
                      ..=
T Consensus       308 l~f  310 (445)
T KOG2139|consen  308 LTF  310 (445)
T ss_pred             Eee
Confidence            663


No 221
>KOG0321 consensus WD40 repeat-containing protein L2DTL [Function unknown]
Probab=98.14  E-value=4.2e-06  Score=105.52  Aligned_cols=115  Identities=15%  Similarity=0.191  Sum_probs=89.6

Q ss_pred             EEEcCC---CCeEEEEeCCCcEEEeecCCCcee---eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2225 FSSHPL---RPFFLVGSSNTHIYLWEFGKDKAT---ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2225 VAFsPd---G~~LASGS~DgTIRLWDl~tGk~l---~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      ..|++.   ..+||-+-+||.|.|+|..+-.-.   +.|.       -++.|.+.|..++.-|-.-+|+++++|.|+|+|
T Consensus        55 ~sFs~~~n~eHiLavadE~G~i~l~dt~~~~fr~ee~~lk-------~~~aH~nAifDl~wapge~~lVsasGDsT~r~W  127 (720)
T KOG0321|consen   55 DSFSAAPNKEHILAVADEDGGIILFDTKSIVFRLEERQLK-------KPLAHKNAIFDLKWAPGESLLVSASGDSTIRPW  127 (720)
T ss_pred             ccccCCCCccceEEEecCCCceeeecchhhhcchhhhhhc-------ccccccceeEeeccCCCceeEEEccCCceeeee
Confidence            456653   347999999999999998643311   1122       134578999999999955799999999999999


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      |+++++   +.-...+.||.+.|.++||.|.|-.+++|||   .|+.|.|||+.
T Consensus       128 dvk~s~---l~G~~~~~GH~~SvkS~cf~~~n~~vF~tGg---RDg~illWD~R  175 (720)
T KOG0321|consen  128 DVKTSR---LVGGRLNLGHTGSVKSECFMPTNPAVFCTGG---RDGEILLWDCR  175 (720)
T ss_pred             eeccce---eecceeecccccccchhhhccCCCcceeecc---CCCcEEEEEEe
Confidence            999863   1223347899999999999997777888864   99999999984


No 222
>PRK02889 tolB translocation protein TolB; Provisional
Probab=98.14  E-value=1.4e-05  Score=99.87  Aligned_cols=141  Identities=10%  Similarity=0.003  Sum_probs=88.9

Q ss_pred             EEEEEcCCCCeEE-EEeCCCcEEEeec--CCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEe
Q 000080         2223 RAFSSHPLRPFFL-VGSSNTHIYLWEF--GKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTW 2298 (2389)
Q Consensus      2223 rsVAFsPdG~~LA-SGS~DgTIRLWDl--~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLW 2298 (2389)
                      .+.+|+|||+.|+ +.+.|+..+||.+  ..+. ++.+.   .       |...+....|||||++|+.++. +|...||
T Consensus       243 ~~~~~SPDG~~la~~~~~~g~~~Iy~~d~~~~~-~~~lt---~-------~~~~~~~~~wSpDG~~l~f~s~~~g~~~Iy  311 (427)
T PRK02889        243 SAPAWSPDGRTLAVALSRDGNSQIYTVNADGSG-LRRLT---Q-------SSGIDTEPFFSPDGRSIYFTSDRGGAPQIY  311 (427)
T ss_pred             cceEECCCCCEEEEEEccCCCceEEEEECCCCC-cEECC---C-------CCCCCcCeEEcCCCCEEEEEecCCCCcEEE
Confidence            4679999999876 5678888777764  3333 33332   1       2234567889999999987765 5788888


Q ss_pred             eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccc
Q 000080         2299 QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      .+...+. .   ...+.-+.......+|+| ||+.||.++....+..|.+||+  .+++ .+.+..+ ......+++|+|
T Consensus       312 ~~~~~~g-~---~~~lt~~g~~~~~~~~Sp-DG~~Ia~~s~~~g~~~I~v~d~--~~g~-~~~lt~~-~~~~~p~~spdg  382 (427)
T PRK02889        312 RMPASGG-A---AQRVTFTGSYNTSPRISP-DGKLLAYISRVGGAFKLYVQDL--ATGQ-VTALTDT-TRDESPSFAPNG  382 (427)
T ss_pred             EEECCCC-c---eEEEecCCCCcCceEECC-CCCEEEEEEccCCcEEEEEEEC--CCCC-eEEccCC-CCccCceECCCC
Confidence            7653211 1   111221223344688999 9999997642222237999997  3343 3444422 344678899999


Q ss_pred             hhhhc
Q 000080         2379 NFALS 2383 (2389)
Q Consensus      2379 ~~~~s 2383 (2389)
                      ++++-
T Consensus       383 ~~l~~  387 (427)
T PRK02889        383 RYILY  387 (427)
T ss_pred             CEEEE
Confidence            87654


No 223
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=98.12  E-value=6.1e-05  Score=99.11  Aligned_cols=134  Identities=11%  Similarity=0.147  Sum_probs=93.9

Q ss_pred             EEEEEEcC-CCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCC--EEEEEECCCCC-EEEEEeCCCc
Q 000080         2222 TRAFSSHP-LRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALAS--ISALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus      2222 VrsVAFsP-dG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~--V~sVaFSPDG~-~LASgS~DgT 2294 (2389)
                      |++++-+. .|.+||.|=.||.||+||.+-.-   .+..++   .       |.+.  |..+.|.+.|- .|+|||.||.
T Consensus      1211 vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a~~ds~v~~~R---~-------h~~~~~Iv~~slq~~G~~elvSgs~~G~ 1280 (1387)
T KOG1517|consen 1211 VTALSADLVHGNIIAAGFADGSVRVYDRRMAPPDSLVCVYR---E-------HNDVEPIVHLSLQRQGLGELVSGSQDGD 1280 (1387)
T ss_pred             ceeecccccCCceEEEeecCCceEEeecccCCccccceeec---c-------cCCcccceeEEeecCCCcceeeeccCCe
Confidence            45554333 37899999999999999987442   455565   2       4455  99999999885 5999999999


Q ss_pred             EEEeeCCCCCccCcccceeeeecC--C-CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeec-----
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFS--S-HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHE----- 2366 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs--~-~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~----- 2366 (2389)
                      |++||++...+   ..+.+...|.  + ..+++..++ ...+||||+   . +.|+||++   .|+.+..+..++     
T Consensus      1281 I~~~DlR~~~~---e~~~~iv~~~~yGs~lTal~VH~-hapiiAsGs---~-q~ikIy~~---~G~~l~~~k~n~~F~~q 1349 (1387)
T KOG1517|consen 1281 IQLLDLRMSSK---ETFLTIVAHWEYGSALTALTVHE-HAPIIASGS---A-QLIKIYSL---SGEQLNIIKYNPGFMGQ 1349 (1387)
T ss_pred             EEEEecccCcc---cccceeeeccccCccceeeeecc-CCCeeeecC---c-ceEEEEec---ChhhhcccccCcccccC
Confidence            99999997321   2334444444  3 377888888 789999963   4 89999998   344444443332     


Q ss_pred             --CcEEEEeecc
Q 000080         2367 --GLYDLFLPLK 2376 (2389)
Q Consensus      2367 --~~V~svA~~~ 2376 (2389)
                        +.+.|+++||
T Consensus      1350 ~~gs~scL~FHP 1361 (1387)
T KOG1517|consen 1350 RIGSVSCLAFHP 1361 (1387)
T ss_pred             cCCCcceeeecc
Confidence              3456777776


No 224
>PRK01029 tolB translocation protein TolB; Provisional
Probab=98.11  E-value=2.7e-05  Score=97.88  Aligned_cols=143  Identities=11%  Similarity=0.042  Sum_probs=90.6

Q ss_pred             EEEEcCCCCeEEEEeC-----CCcEEEeecCCC---ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCc
Q 000080         2224 AFSSHPLRPFFLVGSS-----NTHIYLWEFGKD---KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGT 2294 (2389)
Q Consensus      2224 sVAFsPdG~~LASGS~-----DgTIRLWDl~tG---k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgT 2294 (2389)
                      ..+|||||+.||-.++     |-.+.+||+.+|   +..+...   +       +.+.+...+|||||+.||..+ .+|.
T Consensus       235 ~p~wSPDG~~Laf~s~~~g~~di~~~~~~~~~g~~g~~~~lt~---~-------~~~~~~~p~wSPDG~~Laf~s~~~g~  304 (428)
T PRK01029        235 MPTFSPRKKLLAFISDRYGNPDLFIQSFSLETGAIGKPRRLLN---E-------AFGTQGNPSFSPDGTRLVFVSNKDGR  304 (428)
T ss_pred             ceEECCCCCEEEEEECCCCCcceeEEEeecccCCCCcceEeec---C-------CCCCcCCeEECCCCCEEEEEECCCCC
Confidence            4589999998886553     334555887653   3222221   1       113346789999999999876 4777


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      .+||.+...+. . .....+..+...+...+||| ||+.||..+.......|.+||+  .+++ .+.+......+...+.
T Consensus       305 ~~ly~~~~~~~-g-~~~~~lt~~~~~~~~p~wSP-DG~~Laf~~~~~g~~~I~v~dl--~~g~-~~~Lt~~~~~~~~p~w  378 (428)
T PRK01029        305 PRIYIMQIDPE-G-QSPRLLTKKYRNSSCPAWSP-DGKKIAFCSVIKGVRQICVYDL--ATGR-DYQLTTSPENKESPSW  378 (428)
T ss_pred             ceEEEEECccc-c-cceEEeccCCCCccceeECC-CCCEEEEEEcCCCCcEEEEEEC--CCCC-eEEccCCCCCccceEE
Confidence            77775532100 0 12333444555677899999 9999987643222357999997  3343 4555544456678889


Q ss_pred             cccchhhh
Q 000080         2375 LKLLNFAL 2382 (2389)
Q Consensus      2375 ~~~~~~~~ 2382 (2389)
                      +|+|++++
T Consensus       379 SpDG~~L~  386 (428)
T PRK01029        379 AIDSLHLV  386 (428)
T ss_pred             CCCCCEEE
Confidence            99998865


No 225
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=98.10  E-value=2.5e-05  Score=92.99  Aligned_cols=193  Identities=17%  Similarity=0.276  Sum_probs=127.0

Q ss_pred             eeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-ec-CCeEE
Q 000080           44 IDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA-AS-ENCIF  121 (2389)
Q Consensus        44 i~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA-Sy-DntIR  121 (2389)
                      ..++|+  | .|||.++-..+||+.  +  ..+|.+      |.+.-- |  .|.-+.|..|   ...|++ .| +..|.
T Consensus        14 c~fSp~--g-~yiAs~~~yrlviRd--~--~tlq~~------qlf~cl-d--ki~yieW~ad---s~~ilC~~yk~~~vq   74 (447)
T KOG4497|consen   14 CSFSPC--G-NYIASLSRYRLVIRD--S--ETLQLH------QLFLCL-D--KIVYIEWKAD---SCHILCVAYKDPKVQ   74 (447)
T ss_pred             eeECCC--C-CeeeeeeeeEEEEec--c--chhhHH------HHHHHH-H--Hhhheeeecc---ceeeeeeeeccceEE
Confidence            467888  8 699999999999998  3  122222      333222 2  6889999998   777774 45 67999


Q ss_pred             EEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEE-EEecc--eEEeeccCCcEEEEEEeeccccc-eEEEEeec
Q 000080          122 VFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIV-AGGME--TVLWKKKNTLWEIAWKFKENYPQ-NLVSATWS  197 (2389)
Q Consensus       122 Vw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLa-SggdD--V~IW~~~~s~Wecvwt~~~~~~~-~ivsvaWS  197 (2389)
                      +|.-.      ..+|.|+..- ...-+-+++|||||+-|+ +..++  +.+|...+..--.+     .+|. ++--+++.
T Consensus        75 vwsl~------Qpew~ckIde-g~agls~~~WSPdgrhiL~tseF~lriTVWSL~t~~~~~~-----~~pK~~~kg~~f~  142 (447)
T KOG4497|consen   75 VWSLV------QPEWYCKIDE-GQAGLSSISWSPDGRHILLTSEFDLRITVWSLNTQKGYLL-----PHPKTNVKGYAFH  142 (447)
T ss_pred             EEEee------cceeEEEecc-CCCcceeeeECCCcceEeeeecceeEEEEEEeccceeEEe-----cccccCceeEEEC
Confidence            99876      3469997443 344677899999998777 66667  77999877665544     2333 23355889


Q ss_pred             CCCceEee-ec-ccc--cc--------------cCC-------CCCCCceeEEEeeCCCccceeecccCC-CCeeEEEec
Q 000080          198 IEGPSATA-AS-MSQ--LD--------------LLG-------PKEAGKCVFICCSDGKSEYIKLELCHP-QPVSMVQWR  251 (2389)
Q Consensus       198 pdG~fATa-g~-dik--f~--------------~~~-------~~~~~kpV~V~~~dg~~~~~~ve~aH~-qdVn~V~W~  251 (2389)
                      |||.|++- ++ |-|  ++              ...       =+.++....||++  -.++ +++..|- -.|+.|+|+
T Consensus       143 ~dg~f~ai~sRrDCkdyv~i~~c~~W~ll~~f~~dT~DltgieWsPdg~~laVwd~--~Ley-kv~aYe~~lG~k~v~ws  219 (447)
T KOG4497|consen  143 PDGQFCAILSRRDCKDYVQISSCKAWILLKEFKLDTIDLTGIEWSPDGNWLAVWDN--VLEY-KVYAYERGLGLKFVEWS  219 (447)
T ss_pred             CCCceeeeeecccHHHHHHHHhhHHHHHHHhcCCCcccccCceECCCCcEEEEecc--hhhh-eeeeeeeccceeEEEec
Confidence            99996554 44 222  11              111       1234455667733  2222 2333444 689999999


Q ss_pred             cCCCCCCCCCCccccCceEEeeecCCeEEEEE
Q 000080          252 PSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWC  283 (2389)
Q Consensus       252 Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~  283 (2389)
                      |.             ...||-+|+|+.+||-.
T Consensus       220 P~-------------~qflavGsyD~~lrvln  238 (447)
T KOG4497|consen  220 PC-------------NQFLAVGSYDQMLRVLN  238 (447)
T ss_pred             cc-------------cceEEeeccchhhhhhc
Confidence            93             23599999999999844


No 226
>KOG1310 consensus WD40 repeat protein [General function prediction only]
Probab=98.09  E-value=6.4e-06  Score=102.25  Aligned_cols=132  Identities=20%  Similarity=0.341  Sum_probs=97.3

Q ss_pred             eEEec-ccceEEEEeecCCCCeEEEEecc--eEEeeccCCcEEEEEEeeccccceEEEEeecCC-Cc--eEeeecccc--
Q 000080          139 NAILV-QGTKVEAIEWTGSGDGIVAGGME--TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIE-GP--SATAASMSQ--  210 (2389)
Q Consensus       139 ~~tL~-hssTV~sIAWSpdG~rLaSggdD--V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpd-G~--fATag~dik--  210 (2389)
                      .+.|+ |++-|.+++|+.+|..|||||||  +.||+--  ..+..-.+..-|..+|+++.+=|. +.  ++||++|..  
T Consensus        43 E~eL~GH~GCVN~LeWn~dG~lL~SGSDD~r~ivWd~~--~~KllhsI~TgHtaNIFsvKFvP~tnnriv~sgAgDk~i~  120 (758)
T KOG1310|consen   43 EAELTGHTGCVNCLEWNADGELLASGSDDTRLIVWDPF--EYKLLHSISTGHTANIFSVKFVPYTNNRIVLSGAGDKLIK  120 (758)
T ss_pred             hhhhccccceecceeecCCCCEEeecCCcceEEeecch--hcceeeeeecccccceeEEeeeccCCCeEEEeccCcceEE
Confidence            34444 89999999999999999999999  7799965  344444456678899999999995 33  899999755  


Q ss_pred             -cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCc
Q 000080          211 -LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGK  289 (2389)
Q Consensus       211 -f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk  289 (2389)
                       |......+..      ++++-.+-...+.+|+..|+.++=.|            -.+|+.-|||.|||||=+|+.|.-.
T Consensus       121 lfdl~~~~~~~------~d~~~~~~~~~~~cht~rVKria~~p------------~~PhtfwsasEDGtirQyDiREph~  182 (758)
T KOG1310|consen  121 LFDLDSSKEGG------MDHGMEETTRCWSCHTDRVKRIATAP------------NGPHTFWSASEDGTIRQYDIREPHV  182 (758)
T ss_pred             EEecccccccc------cccCccchhhhhhhhhhhhhheecCC------------CCCceEEEecCCcceeeecccCCcc
Confidence             3333111110      11222222345789999999999988            2578899999999999999998655


Q ss_pred             c
Q 000080          290 T  290 (2389)
Q Consensus       290 ~  290 (2389)
                      +
T Consensus       183 c  183 (758)
T KOG1310|consen  183 C  183 (758)
T ss_pred             C
Confidence            5


No 227
>KOG2106 consensus Uncharacterized conserved protein, contains HELP and WD40 domains [Function unknown]
Probab=98.09  E-value=4.8e-05  Score=94.40  Aligned_cols=133  Identities=15%  Similarity=0.390  Sum_probs=99.0

Q ss_pred             eeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEE
Q 000080         2197 SALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISA 2276 (2389)
Q Consensus      2197 sg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~s 2276 (2389)
                      |+..|..-.+.-+.    .+. |-.|...+|||.++.|+..-.-+++..|+++.|...++-.-++.+      ....|.+
T Consensus       183 SVWdWqk~~~~~~v----k~s-ne~v~~a~FHPtd~nliit~Gk~H~~Fw~~~~~~l~k~~~~fek~------ekk~Vl~  251 (626)
T KOG2106|consen  183 SVWDWQKKAKLGPV----KTS-NEVVFLATFHPTDPNLIITCGKGHLYFWTLRGGSLVKRQGIFEKR------EKKFVLC  251 (626)
T ss_pred             chhhchhhhccCcc----eec-cceEEEEEeccCCCcEEEEeCCceEEEEEccCCceEEEeeccccc------cceEEEE
Confidence            44445444444432    333 223588899999987666667889999999988876653323333      1367999


Q ss_pred             EEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |+|.++|+ ..+|..+|+|.+|+..+.     +..++...|.+.|.+++... +|++| |||   .|+.|-+||-
T Consensus       252 v~F~engd-viTgDS~G~i~Iw~~~~~-----~~~k~~~aH~ggv~~L~~lr-~Gtll-SGg---KDRki~~Wd~  315 (626)
T KOG2106|consen  252 VTFLENGD-VITGDSGGNILIWSKGTN-----RISKQVHAHDGGVFSLCMLR-DGTLL-SGG---KDRKIILWDD  315 (626)
T ss_pred             EEEcCCCC-EEeecCCceEEEEeCCCc-----eEEeEeeecCCceEEEEEec-CccEe-ecC---ccceEEeccc
Confidence            99999997 468999999999999753     44555559999999999998 98877 454   9999999993


No 228
>KOG1523 consensus Actin-related protein Arp2/3 complex, subunit ARPC1/p41-ARC [Cytoskeleton]
Probab=98.05  E-value=4.5e-05  Score=91.05  Aligned_cols=142  Identities=15%  Similarity=0.125  Sum_probs=117.8

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc---eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK---ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk---~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      +|.+-||++|+..+|.+-....|.|+.....+   ..+|+.          -|...|+.|.++|.+++|.+++.|+.-.+
T Consensus        12 pitchAwn~drt~iAv~~~~~evhiy~~~~~~~w~~~htls----------~Hd~~vtgvdWap~snrIvtcs~drnayV   81 (361)
T KOG1523|consen   12 PITCHAWNSDRTQIAVSPNNHEVHIYSMLGADLWEPAHTLS----------EHDKIVTGVDWAPKSNRIVTCSHDRNAYV   81 (361)
T ss_pred             ceeeeeecCCCceEEeccCCceEEEEEecCCCCceeceehh----------hhCcceeEEeecCCCCceeEccCCCCccc
Confidence            34888999999999999999999999986554   345553          25688999999999999999999999999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC------------CCCCCceEEEEee
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL------------APPTSSRASITCH 2365 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l------------~~tg~~v~sL~GH 2365 (2389)
                      |....++  .=+|..-+.-|+..+..|.++| .++.+|++   |..+.|.||-+-            .+....+.+|.-|
T Consensus        82 w~~~~~~--~WkptlvLlRiNrAAt~V~WsP-~enkFAVg---Sgar~isVcy~E~ENdWWVsKhikkPirStv~sldWh  155 (361)
T KOG1523|consen   82 WTQPSGG--TWKPTLVLLRINRAATCVKWSP-KENKFAVG---SGARLISVCYYEQENDWWVSKHIKKPIRSTVTSLDWH  155 (361)
T ss_pred             cccCCCC--eeccceeEEEeccceeeEeecC-cCceEEec---cCccEEEEEEEecccceehhhhhCCccccceeeeecc
Confidence            9995554  2356677778999999999999 88999986   578999999862            2223347889999


Q ss_pred             cCcEEEEeecccc
Q 000080         2366 EGLYDLFLPLKLL 2378 (2389)
Q Consensus      2366 ~~~V~svA~~~~~ 2378 (2389)
                      .++|..-|.+.|+
T Consensus       156 pnnVLlaaGs~D~  168 (361)
T KOG1523|consen  156 PNNVLLAAGSTDG  168 (361)
T ss_pred             CCcceecccccCc
Confidence            9999999999998


No 229
>PF00400 WD40:  WD domain, G-beta repeat;  InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=98.02  E-value=9.4e-06  Score=68.31  Aligned_cols=39  Identities=28%  Similarity=0.475  Sum_probs=34.8

Q ss_pred             CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2251 DKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2251 Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      |+++.+++          ||.+.|++|+|+|++++||||+.|++|++||
T Consensus         1 g~~~~~~~----------~h~~~i~~i~~~~~~~~~~s~~~D~~i~vwd   39 (39)
T PF00400_consen    1 GKCVRTFR----------GHSSSINSIAWSPDGNFLASGSSDGTIRVWD   39 (39)
T ss_dssp             EEEEEEEE----------SSSSSEEEEEEETTSSEEEEEETTSEEEEEE
T ss_pred             CeEEEEEc----------CCCCcEEEEEEecccccceeeCCCCEEEEEC
Confidence            46677774          5779999999999999999999999999997


No 230
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=97.93  E-value=0.00018  Score=92.99  Aligned_cols=148  Identities=16%  Similarity=0.184  Sum_probs=102.3

Q ss_pred             eeEEEEEEcCCCC-eEEEEeCCCcEEE---eecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcE
Q 000080         2220 ISTRAFSSHPLRP-FFLVGSSNTHIYL---WEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTV 2295 (2389)
Q Consensus      2220 i~VrsVAFsPdG~-~LASGS~DgTIRL---WDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTV 2295 (2389)
                      +.+.+++|+|.-+ .++.|+++|.|.-   ++...+.. ..|   ++|..+ .-|.+.|++|.+||-+..+...+.|-||
T Consensus       348 ~~~t~~~F~~~~p~~FiVGTe~G~v~~~~r~g~~~~~~-~~~---~~~~~~-~~h~g~v~~v~~nPF~~k~fls~gDW~v  422 (555)
T KOG1587|consen  348 VGATSLKFEPTDPNHFIVGTEEGKVYKGCRKGYTPAPE-VSY---KGHSTF-ITHIGPVYAVSRNPFYPKNFLSVGDWTV  422 (555)
T ss_pred             cceeeEeeccCCCceEEEEcCCcEEEEEeccCCccccc-ccc---cccccc-cccCcceEeeecCCCccceeeeecccee
Confidence            5778999999766 5888999999977   33322221 222   233222 2467899999999999766666669999


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      |||.-...    ..|+..+..+...|.+++|||---.++|++   ..||+|-|||++..+-..+.+..-+....+.+..+
T Consensus       423 riWs~~~~----~~Pl~~~~~~~~~v~~vaWSptrpavF~~~---d~~G~l~iWDLl~~~~~Pv~s~~~~~~~l~~~~~s  495 (555)
T KOG1587|consen  423 RIWSEDVI----ASPLLSLDSSPDYVTDVAWSPTRPAVFATV---DGDGNLDIWDLLQDDEEPVLSQKVCSPALTRVRWS  495 (555)
T ss_pred             EeccccCC----CCcchhhhhccceeeeeEEcCcCceEEEEE---cCCCceehhhhhccccCCcccccccccccceeecC
Confidence            99987632    268888888999999999999333466664   58999999999755444455543334444455555


Q ss_pred             ccch
Q 000080         2376 KLLN 2379 (2389)
Q Consensus      2376 ~~~~ 2379 (2389)
                      +.|+
T Consensus       496 ~~g~  499 (555)
T KOG1587|consen  496 PNGK  499 (555)
T ss_pred             CCCc
Confidence            4443


No 231
>TIGR02800 propeller_TolB tol-pal system beta propeller repeat protein TolB. The Tol-PAL system is required for bacterial outer membrane integrity. E. coli TolB is involved in the tonB-independent uptake of group A colicins (colicins A, E1, E2, E3 and K), and is necessary for the colicins to reach their respective targets after initial binding to the bacteria. It is also involved in uptake of filamentous DNA. Study of its structure suggest that the TolB protein might be involved in the recycling of peptidoglycan or in its covalent linking with lipoproteins. The Tol-Pal system is also implicated in pathogenesis of E. coli, Haemophilus ducreyi, Salmonella enterica and Vibrio cholerae, but the mechanism(s) is unclear.
Probab=97.93  E-value=8.7e-05  Score=91.12  Aligned_cols=139  Identities=16%  Similarity=0.103  Sum_probs=88.8

Q ss_pred             EEEEEcCCCCeEE-EEeCC--CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-C--cEE
Q 000080         2223 RAFSSHPLRPFFL-VGSSN--THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-G--TVC 2296 (2389)
Q Consensus      2223 rsVAFsPdG~~LA-SGS~D--gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-g--TVk 2296 (2389)
                      .+++|+|||+.|+ +.+.+  ..|++||+.+++..+ +.   .       +...+...+|+|||++|+.++.. +  .|.
T Consensus       237 ~~~~~spDg~~l~~~~~~~~~~~i~~~d~~~~~~~~-l~---~-------~~~~~~~~~~s~dg~~l~~~s~~~g~~~iy  305 (417)
T TIGR02800       237 GAPAFSPDGSKLAVSLSKDGNPDIYVMDLDGKQLTR-LT---N-------GPGIDTEPSWSPDGKSIAFTSDRGGSPQIY  305 (417)
T ss_pred             cceEECCCCCEEEEEECCCCCccEEEEECCCCCEEE-CC---C-------CCCCCCCEEECCCCCEEEEEECCCCCceEE
Confidence            4568999999765 44444  469999998776433 21   1       12335577899999999877653 3  577


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecc
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~ 2376 (2389)
                      +||+.++.      ...+..+...+..++|+| ||++|+.++.......|.+||+.  + ...+.+..+ ......+++|
T Consensus       306 ~~d~~~~~------~~~l~~~~~~~~~~~~sp-dg~~i~~~~~~~~~~~i~~~d~~--~-~~~~~l~~~-~~~~~p~~sp  374 (417)
T TIGR02800       306 MMDADGGE------VRRLTFRGGYNASPSWSP-DGDLIAFVHREGGGFNIAVMDLD--G-GGERVLTDT-GLDESPSFAP  374 (417)
T ss_pred             EEECCCCC------EEEeecCCCCccCeEECC-CCCEEEEEEccCCceEEEEEeCC--C-CCeEEccCC-CCCCCceECC
Confidence            77877642      233444556677889999 89999886421111278888873  3 334444332 2234567888


Q ss_pred             cchhhhc
Q 000080         2377 LLNFALS 2383 (2389)
Q Consensus      2377 ~~~~~~s 2383 (2389)
                      +|++++.
T Consensus       375 dg~~l~~  381 (417)
T TIGR02800       375 NGRMILY  381 (417)
T ss_pred             CCCEEEE
Confidence            8887654


No 232
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.90  E-value=6.1e-05  Score=100.40  Aligned_cols=146  Identities=17%  Similarity=0.221  Sum_probs=97.4

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCC-----C--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGK-----D--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~t-----G--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      ...+|++.+++|||+|||||+||...     +  ++..||.          .....|.+|.+-+.|+.+|.|+.||.|++
T Consensus      1055 a~s~~~~s~FvsgS~DGtVKvW~~~k~~~~~~s~rS~ltys----------~~~sr~~~vt~~~~~~~~Av~t~DG~v~~ 1124 (1431)
T KOG1240|consen 1055 AVSSEHTSLFVSGSDDGTVKVWNLRKLEGEGGSARSELTYS----------PEGSRVEKVTMCGNGDQFAVSTKDGSVRV 1124 (1431)
T ss_pred             eecCCCCceEEEecCCceEEEeeehhhhcCcceeeeeEEEe----------ccCCceEEEEeccCCCeEEEEcCCCeEEE
Confidence            34555669999999999999999752     1  2334442          02378999999999999999999999999


Q ss_pred             eeCCCC--CccCccc--ceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2298 WQLEVG--GRSNVRP--MESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2298 WDl~tg--grs~~k~--l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      -+++..  .+-....  ...+.....-|..-+|...+++ .|+-+   ..-+-|..||+...+.-..-..+-..|-|+++
T Consensus      1125 ~~id~~~~~~~~~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~---T~~~~iv~~D~r~~~~~w~lk~~~~hG~vTSi 1201 (1431)
T KOG1240|consen 1125 LRIDHYNVSKRVATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYA---TDLSRIVSWDTRMRHDAWRLKNQLRHGLVTSI 1201 (1431)
T ss_pred             EEccccccccceeeeeecccccCCCceEEeecccccccceeEEEE---EeccceEEecchhhhhHHhhhcCccccceeEE
Confidence            999762  1000000  0111222233445566655666 55543   46778999998533222223344466889999


Q ss_pred             eecccchhhhc
Q 000080         2373 LPLKLLNFALS 2383 (2389)
Q Consensus      2373 A~~~~~~~~~s 2383 (2389)
                      +.+|-++|++.
T Consensus      1202 ~idp~~~Wlvi 1212 (1431)
T KOG1240|consen 1202 VIDPWCNWLVI 1212 (1431)
T ss_pred             EecCCceEEEE
Confidence            99999999875


No 233
>PRK04792 tolB translocation protein TolB; Provisional
Probab=97.87  E-value=0.00064  Score=86.17  Aligned_cols=198  Identities=12%  Similarity=0.129  Sum_probs=104.8

Q ss_pred             CcceeecCCCCCCeEEEEec---CCc-EEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE--
Q 000080           41 TSTIDWLPDFAGYSWVAYGA---SSL-LVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA--  114 (2389)
Q Consensus        41 ~~ai~wlpD~~G~~~vAYas---g~~-vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA--  114 (2389)
                      ...+.|+||  | .++||.+   +.. |.+..+.   .+.. .      ++-...+   .+...+||||   +..|+.  
T Consensus       220 ~~~p~wSPD--G-~~La~~s~~~g~~~L~~~dl~---tg~~-~------~lt~~~g---~~~~~~wSPD---G~~La~~~  280 (448)
T PRK04792        220 LMSPAWSPD--G-RKLAYVSFENRKAEIFVQDIY---TQVR-E------KVTSFPG---INGAPRFSPD---GKKLALVL  280 (448)
T ss_pred             ccCceECCC--C-CEEEEEEecCCCcEEEEEECC---CCCe-E------EecCCCC---CcCCeeECCC---CCEEEEEE
Confidence            347899999  7 4888874   332 4444422   2211 1      1111111   2457899998   666774  


Q ss_pred             ecCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc---eEEee--ccCCcEEEEEEeecccc
Q 000080          115 ASENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME---TVLWK--KKNTLWEIAWKFKENYP  188 (2389)
Q Consensus       115 SyDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD---V~IW~--~~~s~Wecvwt~~~~~~  188 (2389)
                      +.++...||.-+.  ..+.     ...++ +...+...+|+|||++|+..++.   .+||.  ..++.++.+. ..+   
T Consensus       281 ~~~g~~~Iy~~dl--~tg~-----~~~lt~~~~~~~~p~wSpDG~~I~f~s~~~g~~~Iy~~dl~~g~~~~Lt-~~g---  349 (448)
T PRK04792        281 SKDGQPEIYVVDI--ATKA-----LTRITRHRAIDTEPSWHPDGKSLIFTSERGGKPQIYRVNLASGKVSRLT-FEG---  349 (448)
T ss_pred             eCCCCeEEEEEEC--CCCC-----eEECccCCCCccceEECCCCCEEEEEECCCCCceEEEEECCCCCEEEEe-cCC---
Confidence            3356666665541  1121     11233 34456778999999999976652   45554  4556666552 111   


Q ss_pred             ceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080          189 QNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR  267 (2389)
Q Consensus       189 ~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~  267 (2389)
                      ......+|||||. +|.++....         .--++++.-++.. ...+. ....+ ....|+|        ||+.   
T Consensus       350 ~~~~~~~~SpDG~~l~~~~~~~g---------~~~I~~~dl~~g~-~~~lt-~~~~d-~~ps~sp--------dG~~---  406 (448)
T PRK04792        350 EQNLGGSITPDGRSMIMVNRTNG---------KFNIARQDLETGA-MQVLT-STRLD-ESPSVAP--------NGTM---  406 (448)
T ss_pred             CCCcCeeECCCCCEEEEEEecCC---------ceEEEEEECCCCC-eEEcc-CCCCC-CCceECC--------CCCE---
Confidence            1223568999999 766654211         0112222211111 11111 11122 2347999        6665   


Q ss_pred             ceEEeeecCCeEEEEEeecCCcccc
Q 000080          268 HVLLTCCLDGTVRLWCEMDSGKTRK  292 (2389)
Q Consensus       268 nILAScSdDgTVRLW~e~d~Gk~kk  292 (2389)
                       |+.++..+|.-+||-.+-.|+.++
T Consensus       407 -I~~~~~~~g~~~l~~~~~~G~~~~  430 (448)
T PRK04792        407 -VIYSTTYQGKQVLAAVSIDGRFKA  430 (448)
T ss_pred             -EEEEEecCCceEEEEEECCCCceE
Confidence             456666677767776655565543


No 234
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=97.87  E-value=5.9e-05  Score=98.40  Aligned_cols=132  Identities=17%  Similarity=0.300  Sum_probs=97.2

Q ss_pred             ccccccccccccc---cCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEee-cC-CC-ceeeEecccCCCCCCCCCCCC
Q 000080         2199 LGWETQDDFEDYV---DPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWE-FG-KD-KATATYGVLPAANVPPPYALA 2272 (2389)
Q Consensus      2199 ~~~d~~~~~~~~~---d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWD-l~-tG-k~l~Tl~vl~gh~~p~~GH~~ 2272 (2389)
                      +.|......+-+.   ....+..+  +..+++||+++++|+|-.||.|.+|. ++ .+ +...+.  +       .=|.+
T Consensus       184 ~~~~v~~~~~~~~~~~~~~~Htf~--~t~~~~spn~~~~Aa~d~dGrI~vw~d~~~~~~~~t~t~--l-------HWH~~  252 (792)
T KOG1963|consen  184 HIYFVPKHTKHTSSRDITVHHTFN--ITCVALSPNERYLAAGDSDGRILVWRDFGSSDDSETCTL--L-------HWHHD  252 (792)
T ss_pred             EEEEecccceeeccchhhhhhccc--ceeEEeccccceEEEeccCCcEEEEeccccccccccceE--E-------Eeccc
Confidence            4666666444332   22233333  48899999999999999999999997 43 12 222222  1       23668


Q ss_pred             CEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2273 SISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2273 ~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      .|.+++||+||..|.||+..|.+-+|+++|+++    .+..  --.+.|..+.+|| ||.+.+..   -+|+.|.|=..
T Consensus       253 ~V~~L~fS~~G~~LlSGG~E~VLv~Wq~~T~~k----qfLP--RLgs~I~~i~vS~-ds~~~sl~---~~DNqI~li~~  321 (792)
T KOG1963|consen  253 EVNSLSFSSDGAYLLSGGREGVLVLWQLETGKK----QFLP--RLGSPILHIVVSP-DSDLYSLV---LEDNQIHLIKA  321 (792)
T ss_pred             ccceeEEecCCceEeecccceEEEEEeecCCCc----cccc--ccCCeeEEEEEcC-CCCeEEEE---ecCceEEEEec
Confidence            999999999999999999999999999999853    2322  2357899999999 88888764   47999888775


No 235
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.78  E-value=9.6e-05  Score=88.34  Aligned_cols=105  Identities=13%  Similarity=0.191  Sum_probs=77.3

Q ss_pred             eEEE-EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-EEEeeCCCCCccCccc
Q 000080         2233 FFLV-GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-VCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2233 ~LAS-GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-VkLWDl~tggrs~~k~ 2310 (2389)
                      +||- |-.=|+|+|=|+..-+.-.+.. ++       .|.+.|.+|+.+-+|.++||||..|| |||||.++|+  .++.
T Consensus       150 ~LafPg~k~GqvQi~dL~~~~~~~p~~-I~-------AH~s~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~--~l~E  219 (346)
T KOG2111|consen  150 LLAFPGFKTGQVQIVDLASTKPNAPSI-IN-------AHDSDIACVALNLQGTLVATASTKGTLIRIFDTEDGT--LLQE  219 (346)
T ss_pred             EEEcCCCccceEEEEEhhhcCcCCceE-EE-------cccCceeEEEEcCCccEEEEeccCcEEEEEEEcCCCc--Eeee
Confidence            4443 4455778888876444311111 12       46799999999999999999999999 7999999985  2233


Q ss_pred             ceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2311 MESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2311 l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      ++.-..| ..|++++||| ++++||.+   |+-+||.|..+.
T Consensus       220 ~RRG~d~-A~iy~iaFSp-~~s~Lavs---SdKgTlHiF~l~  256 (346)
T KOG2111|consen  220 LRRGVDR-ADIYCIAFSP-NSSWLAVS---SDKGTLHIFSLR  256 (346)
T ss_pred             eecCCch-heEEEEEeCC-CccEEEEE---cCCCeEEEEEee
Confidence            3332223 5689999999 99999986   799999999974


No 236
>KOG2111 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=97.77  E-value=8.4e-05  Score=88.83  Aligned_cols=75  Identities=12%  Similarity=0.132  Sum_probs=65.8

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .|..|+.+-+|..+||+|..|| |||||..+|+.++.++  .|-      ..+.|++++||||+.+||.+|+-|||.+..
T Consensus       183 ~Iacv~Ln~~Gt~vATaStkGTLIRIFdt~~g~~l~E~R--RG~------d~A~iy~iaFSp~~s~LavsSdKgTlHiF~  254 (346)
T KOG2111|consen  183 DIACVALNLQGTLVATASTKGTLIRIFDTEDGTLLQELR--RGV------DRADIYCIAFSPNSSWLAVSSDKGTLHIFS  254 (346)
T ss_pred             ceeEEEEcCCccEEEEeccCcEEEEEEEcCCCcEeeeee--cCC------chheEEEEEeCCCccEEEEEcCCCeEEEEE
Confidence            3588999999999999999988 5999999999998886  232      226799999999999999999999999999


Q ss_pred             CCCC
Q 000080         2300 LEVG 2303 (2389)
Q Consensus      2300 l~tg 2303 (2389)
                      ++..
T Consensus       255 l~~~  258 (346)
T KOG2111|consen  255 LRDT  258 (346)
T ss_pred             eecC
Confidence            9763


No 237
>KOG4547 consensus WD40 repeat-containing protein [General function prediction only]
Probab=97.76  E-value=0.00024  Score=89.98  Aligned_cols=130  Identities=11%  Similarity=0.066  Sum_probs=100.9

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      ..|.++..+.+...|-|++.|+.+-.|+...++.++.+..          -...|.+++++|||+.|++||  ++|++||
T Consensus       103 ~~v~~~~~~~~~~ciyS~~ad~~v~~~~~~~~~~~~~~~~----------~~~~~~sl~is~D~~~l~~as--~~ik~~~  170 (541)
T KOG4547|consen  103 GNVNEILDAQRLGCIYSVGADLKVVYILEKEKVIIRIWKE----------QKPLVSSLCISPDGKILLTAS--RQIKVLD  170 (541)
T ss_pred             CcceeeecccccCceEecCCceeEEEEecccceeeeeecc----------CCCccceEEEcCCCCEEEecc--ceEEEEE
Confidence            3568889999999999999999999999998888888763          135699999999999999998  5799999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCC-----CCEEEEeecCCCCCeEEEeeCCCCCC-Cc-eEEEEeecCcE
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSS-----GSVIAAAGHSSNGINVVVWDTLAPPT-SS-RASITCHEGLY 2369 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~D-----GslLASAG~sS~D~TVrLWD~l~~tg-~~-v~sL~GH~~~V 2369 (2389)
                      ++++     +.+.++.||.+.|++++|.. +     |.++.++.  ..++-|.+|-+..... +. .++|..-.-+|
T Consensus       171 ~~~k-----evv~~ftgh~s~v~t~~f~~-~~~g~~G~~vLssa--~~~r~i~~w~v~~~~kkks~~~sl~~~dipv  239 (541)
T KOG4547|consen  171 IETK-----EVVITFTGHGSPVRTLSFTT-LIDGIIGKYVLSSA--AAERGITVWVVEKEDKKKSLSCSLTVPDIPV  239 (541)
T ss_pred             ccCc-----eEEEEecCCCcceEEEEEEE-eccccccceeeecc--ccccceeEEEEEcccccchhheeeccCCCCe
Confidence            9996     57899999999999999998 5     55555532  3566688887743222 22 45665443333


No 238
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.75  E-value=0.0002  Score=87.46  Aligned_cols=121  Identities=12%  Similarity=0.082  Sum_probs=100.0

Q ss_pred             eeEEEEEEcCC--CCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080         2220 ISTRAFSSHPL--RPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2220 i~VrsVAFsPd--G~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
                      |.+.++.|-|.  ...||+++.=+.||+||.+.++ .+.+|..          -...|+++...|+|+++.+|..-|.+.
T Consensus       203 vW~tdi~Fl~g~~~~~fat~T~~hqvR~YDt~~qRRPV~~fd~----------~E~~is~~~l~p~gn~Iy~gn~~g~l~  272 (412)
T KOG3881|consen  203 VWITDIRFLEGSPNYKFATITRYHQVRLYDTRHQRRPVAQFDF----------LENPISSTGLTPSGNFIYTGNTKGQLA  272 (412)
T ss_pred             eeeccceecCCCCCceEEEEecceeEEEecCcccCcceeEecc----------ccCcceeeeecCCCcEEEEecccchhh
Confidence            34567899998  7789999999999999999886 5666642          246799999999999999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceE
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRA 2360 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~ 2360 (2389)
                      ..|++++.    .....+.|.++.+++|.-+| ++.+||++|   -|+.|||.|+  .+.+.++
T Consensus       273 ~FD~r~~k----l~g~~~kg~tGsirsih~hp-~~~~las~G---LDRyvRIhD~--ktrkll~  326 (412)
T KOG3881|consen  273 KFDLRGGK----LLGCGLKGITGSIRSIHCHP-THPVLASCG---LDRYVRIHDI--KTRKLLH  326 (412)
T ss_pred             eecccCce----eeccccCCccCCcceEEEcC-CCceEEeec---cceeEEEeec--ccchhhh
Confidence            99999862    23345788899999999999 889999986   8999999997  3444443


No 239
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=97.71  E-value=0.00014  Score=91.44  Aligned_cols=146  Identities=15%  Similarity=0.209  Sum_probs=105.0

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC--CCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA--NVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh--~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      ..++.|..+|-..+|++|+.||.|..||.++...+.++.. +-+  ..|-......|+++.|+-||=.+|.|..+|.|.|
T Consensus       176 ~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~ksrv~~l~~-~~~v~s~pg~~~~~svTal~F~d~gL~~aVGts~G~v~i  254 (703)
T KOG2321|consen  176 GELNVVSINEEHGLLACGTEDGVVEFWDPRDKSRVGTLDA-ASSVNSHPGGDAAPSVTALKFRDDGLHVAVGTSTGSVLI  254 (703)
T ss_pred             ccceeeeecCccceEEecccCceEEEecchhhhhheeeec-ccccCCCccccccCcceEEEecCCceeEEeeccCCcEEE
Confidence            3458889999999999999999999999988877766641 111  0111112346999999999999999999999999


Q ss_pred             eeCCCCCccCccccee-eeecCCCeeEEEEecC-CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080         2298 WQLEVGGRSNVRPMES-CLCFSSHAMDVSYITS-SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~-DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      +|+++.     +|+.. -.+-.-+|..+.|.+. ++..|+|.    +-+.+||||-  .+|+...+++ -+..++-+++-
T Consensus       255 yDLRa~-----~pl~~kdh~~e~pi~~l~~~~~~~q~~v~S~----Dk~~~kiWd~--~~Gk~~asiE-pt~~lND~C~~  322 (703)
T KOG2321|consen  255 YDLRAS-----KPLLVKDHGYELPIKKLDWQDTDQQNKVVSM----DKRILKIWDE--CTGKPMASIE-PTSDLNDFCFV  322 (703)
T ss_pred             EEcccC-----CceeecccCCccceeeecccccCCCceEEec----chHHhhhccc--ccCCceeecc-ccCCcCceeee
Confidence            999985     34322 2233456778888874 24577774    7789999996  4666666665 33346666666


Q ss_pred             ccc
Q 000080         2376 KLL 2378 (2389)
Q Consensus      2376 ~~~ 2378 (2389)
                      |.+
T Consensus       323 p~s  325 (703)
T KOG2321|consen  323 PGS  325 (703)
T ss_pred             cCC
Confidence            554


No 240
>KOG1517 consensus Guanine nucleotide binding protein MIP1 [Cell cycle control, cell division, chromosome partitioning]
Probab=97.71  E-value=0.00029  Score=93.07  Aligned_cols=140  Identities=16%  Similarity=0.152  Sum_probs=99.6

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCCCC
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
                      ++|......|+++|+=..|||||..+.+.++..         |.|...-|+++.-+ +.|+.+|.|-.||.||++|.+..
T Consensus      1171 ~dWqQ~~G~Ll~tGd~r~IRIWDa~~E~~~~di---------P~~s~t~vTaLS~~~~~gn~i~AGfaDGsvRvyD~R~a 1241 (1387)
T KOG1517|consen 1171 VDWQQQSGHLLVTGDVRSIRIWDAHKEQVVADI---------PYGSSTLVTALSADLVHGNIIAAGFADGSVRVYDRRMA 1241 (1387)
T ss_pred             eehhhhCCeEEecCCeeEEEEEecccceeEeec---------ccCCCccceeecccccCCceEEEeecCCceEEeecccC
Confidence            477777777777778899999999876666554         13455678888665 44799999999999999999986


Q ss_pred             CccCcccceeeeecCCC--eeEEEEecCCCCE-EEEeecCCCCCeEEEeeCCCCCCCceEEEEeec--C-cEEEEeeccc
Q 000080         2304 GRSNVRPMESCLCFSSH--AMDVSYITSSGSV-IAAAGHSSNGINVVVWDTLAPPTSSRASITCHE--G-LYDLFLPLKL 2377 (2389)
Q Consensus      2304 grs~~k~l~tl~gHs~~--V~sVAFSP~DGsl-LASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~--~-~V~svA~~~~ 2377 (2389)
                      .+  ...+.....|+..  |..+.+-+ .|-. |+||   |.||.|++||+..+.....-++..|.  | ..+++..|+.
T Consensus      1242 ~~--ds~v~~~R~h~~~~~Iv~~slq~-~G~~elvSg---s~~G~I~~~DlR~~~~e~~~~iv~~~~yGs~lTal~VH~h 1315 (1387)
T KOG1517|consen 1242 PP--DSLVCVYREHNDVEPIVHLSLQR-QGLGELVSG---SQDGDIQLLDLRMSSKETFLTIVAHWEYGSALTALTVHEH 1315 (1387)
T ss_pred             Cc--cccceeecccCCcccceeEEeec-CCCcceeee---ccCCeEEEEecccCcccccceeeeccccCccceeeeeccC
Confidence            31  1356677889988  99999998 4433 7775   69999999998643333333334343  3 2666666665


Q ss_pred             ch
Q 000080         2378 LN 2379 (2389)
Q Consensus      2378 ~~ 2379 (2389)
                      -+
T Consensus      1316 ap 1317 (1387)
T KOG1517|consen 1316 AP 1317 (1387)
T ss_pred             CC
Confidence            43


No 241
>KOG1963 consensus WD40 repeat protein [General function prediction only]
Probab=97.71  E-value=0.00029  Score=92.17  Aligned_cols=142  Identities=11%  Similarity=0.117  Sum_probs=103.2

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe-eCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW-QLE 2301 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW-Dl~ 2301 (2389)
                      +.|.+++.|.+.+-. .+..+.+|++.++.. .+.. ..-+    --|+-.+++++|||.|+.+|+|..||.|.+| |..
T Consensus       164 ~~I~~~~~ge~~~i~-~~~~~~~~~v~~~~~-~~~~-~~~~----~~Htf~~t~~~~spn~~~~Aa~d~dGrI~vw~d~~  236 (792)
T KOG1963|consen  164 KSIVDNNSGEFKGIV-HMCKIHIYFVPKHTK-HTSS-RDIT----VHHTFNITCVALSPNERYLAAGDSDGRILVWRDFG  236 (792)
T ss_pred             ccEEEcCCceEEEEE-EeeeEEEEEecccce-eecc-chhh----hhhcccceeEEeccccceEEEeccCCcEEEEeccc
Confidence            456899998876654 566799999987662 2211 0111    1255558999999999999999999999999 444


Q ss_pred             CCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchh
Q 000080         2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      ..+.+  .....+.-|...|.+++|++ ||.+|.|||   ..+...+|.+  .+++ .+=|.-=.+.|..+..|||++-
T Consensus       237 ~~~~~--~t~t~lHWH~~~V~~L~fS~-~G~~LlSGG---~E~VLv~Wq~--~T~~-kqfLPRLgs~I~~i~vS~ds~~  306 (792)
T KOG1963|consen  237 SSDDS--ETCTLLHWHHDEVNSLSFSS-DGAYLLSGG---REGVLVLWQL--ETGK-KQFLPRLGSPILHIVVSPDSDL  306 (792)
T ss_pred             ccccc--ccceEEEecccccceeEEec-CCceEeecc---cceEEEEEee--cCCC-cccccccCCeeEEEEEcCCCCe
Confidence            11111  23456778999999999999 999999986   7899999998  4444 3444445566888888888863


No 242
>KOG4227 consensus WD40 repeat protein [General function prediction only]
Probab=97.67  E-value=0.00037  Score=84.45  Aligned_cols=180  Identities=9%  Similarity=-0.028  Sum_probs=124.1

Q ss_pred             ccccceeeccccccccccccc--------cCCCCcCc---eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecc
Q 000080         2191 YAGIGASALGWETQDDFEDYV--------DPPATVEN---ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGV 2259 (2389)
Q Consensus      2191 ~~~~~Asg~~~d~~~~~~~~~--------d~~atv~n---i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~v 2259 (2389)
                      -+.-+||| |.|-..++|...        +|+.-.+.   --|.+++|....+++.||..|++|.+-|+++.+.+..+. 
T Consensus        67 N~~~L~SG-GDD~~~~~W~~de~~~~k~~KPI~~~~~~H~SNIF~L~F~~~N~~~~SG~~~~~VI~HDiEt~qsi~V~~-  144 (609)
T KOG4227|consen   67 NDRFLASG-GDDMHGRVWNVDELMVRKTPKPIGVMEHPHRSNIFSLEFDLENRFLYSGERWGTVIKHDIETKQSIYVAN-  144 (609)
T ss_pred             CCeEEeec-CCcceeeeechHHHHhhcCCCCceeccCccccceEEEEEccCCeeEecCCCcceeEeeecccceeeeeec-
Confidence            35567777 777777777542        22221110   124899999999999999999999999999988777663 


Q ss_pred             cCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeec
Q 000080         2260 LPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus      2260 l~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
                         |+    ...+.|+.+.-+|-.+.||+.+.|+.|.+||++..  .++-...-+..-.+.-+++-|+|-.-.+||++  
T Consensus       145 ---~~----~~~~~VY~m~~~P~DN~~~~~t~~~~V~~~D~Rd~--~~~~~~~~~AN~~~~F~t~~F~P~~P~Li~~~--  213 (609)
T KOG4227|consen  145 ---EN----NNRGDVYHMDQHPTDNTLIVVTRAKLVSFIDNRDR--QNPISLVLPANSGKNFYTAEFHPETPALILVN--  213 (609)
T ss_pred             ---cc----CcccceeecccCCCCceEEEEecCceEEEEeccCC--CCCCceeeecCCCccceeeeecCCCceeEEec--
Confidence               32    12358999999999999999999999999999864  12222233334445667899999777889887  


Q ss_pred             CCCCCeEEEeeCCCCCCCce-----EEEEeecCcEEEEeecccchhhhcc
Q 000080         2340 SSNGINVVVWDTLAPPTSSR-----ASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2340 sS~D~TVrLWD~l~~tg~~v-----~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                       ++-+-+-|||...+.....     ..|+.....--++-+++.|+-.|+-
T Consensus       214 -~~~~G~~~~D~R~~~~~~~~~~~~~~L~~~~~~~M~~~~~~~G~Q~msi  262 (609)
T KOG4227|consen  214 -SETGGPNVFDRRMQARPVYQRSMFKGLPQENTEWMGSLWSPSGNQFMSI  262 (609)
T ss_pred             -cccCCCCceeeccccchHHhhhccccCcccchhhhheeeCCCCCeehhh
Confidence             4566689999865443222     1232211111366788888877764


No 243
>PF04762 IKI3:  IKI3 family;  InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=97.67  E-value=0.0057  Score=84.07  Aligned_cols=238  Identities=17%  Similarity=0.310  Sum_probs=140.7

Q ss_pred             CCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCccc-ccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEE-
Q 000080           37 PTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQ-EEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAA-  114 (2389)
Q Consensus        37 p~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~-~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaA-  114 (2389)
                      +....-.+.+++|-..+ .+|+++|.-+++.-=|+|... .|.+          |.-| .-|.+.+||||    +|++| 
T Consensus        74 ~~~~ivs~~yl~d~~~l-~~~~~~Gdi~~~~~~~~~~~~~~E~V----------G~vd-~GI~a~~WSPD----~Ella~  137 (928)
T PF04762_consen   74 PNDKIVSFQYLADSESL-CIALASGDIILVREDPDPDEDEIEIV----------GSVD-SGILAASWSPD----EELLAL  137 (928)
T ss_pred             CCCcEEEEEeccCCCcE-EEEECCceEEEEEccCCCCCceeEEE----------EEEc-CcEEEEEECCC----cCEEEE
Confidence            33444555666775553 788888888888652222222 1222          3333 36999999998    67664 


Q ss_pred             -ecCCeEEEEeeC--C-------CCCCC-----CccceeeEEec--------------------------ccceEEEEee
Q 000080          115 -ASENCIFVFAHD--S-------ASSKG-----SFCWSQNAILV--------------------------QGTKVEAIEW  153 (2389)
Q Consensus       115 -SyDntIRVw~~d--~-------~~~kg-----d~~W~~~~tL~--------------------------hssTV~sIAW  153 (2389)
                       ..++++-+-..+  +       ..+-+     +..|..+.|=.                          ....--.|+|
T Consensus       138 vT~~~~l~~mt~~fd~i~E~~l~~~~~~~~~~VsVGWGkKeTQF~Gs~gK~aa~~~~~p~~~~~d~~~~s~dd~~~~ISW  217 (928)
T PF04762_consen  138 VTGEGNLLLMTRDFDPISEVPLDSDDFGESKHVSVGWGKKETQFHGSAGKAAARQLRDPTVPKVDEGKLSWDDGRVRISW  217 (928)
T ss_pred             EeCCCEEEEEeccceEEEEeecCccccCCCceeeeccCcccCccCcchhhhhhhhccCCCCCccccCccccCCCceEEEE
Confidence             566677665321  0       00111     12466653331                          1112346999


Q ss_pred             cCCCCeEEEEec----c----eEEeeccCCcEEEEEEeeccccceEE--EEeecCCCc-eEeeecccccccCCCCCCCce
Q 000080          154 TGSGDGIVAGGM----E----TVLWKKKNTLWEIAWKFKENYPQNLV--SATWSIEGP-SATAASMSQLDLLGPKEAGKC  222 (2389)
Q Consensus       154 SpdG~rLaSggd----D----V~IW~~~~s~Wecvwt~~~~~~~~iv--svaWSpdG~-fATag~dikf~~~~~~~~~kp  222 (2389)
                      -+||.+.|..+-    +    ++||++. +  +.-.++  + +.+-.  .++|.|.|. +|++-+..         ...-
T Consensus       218 RGDG~yFAVss~~~~~~~~R~iRVy~Re-G--~L~stS--E-~v~gLe~~l~WrPsG~lIA~~q~~~---------~~~~  282 (928)
T PF04762_consen  218 RGDGEYFAVSSVEPETGSRRVIRVYSRE-G--ELQSTS--E-PVDGLEGALSWRPSGNLIASSQRLP---------DRHD  282 (928)
T ss_pred             CCCCcEEEEEEEEcCCCceeEEEEECCC-c--eEEecc--c-cCCCccCCccCCCCCCEEEEEEEcC---------CCcE
Confidence            999999995553    1    7799865 2  333222  2 22222  669999999 88887611         0122


Q ss_pred             eEEEeeCCCccceee--cccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeecCCcccccccccCCC
Q 000080          223 VFICCSDGKSEYIKL--ELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMDSGKTRKVAKDTNDH  300 (2389)
Q Consensus       223 V~V~~~dg~~~~~~v--e~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d~Gk~kk~~~~~~d~  300 (2389)
                      |..+|.+|-.--++.  .......|..++|++             ..+|||-...|. |+||..-               
T Consensus       283 VvFfErNGLrhgeF~l~~~~~~~~v~~l~Wn~-------------ds~iLAv~~~~~-vqLWt~~---------------  333 (928)
T PF04762_consen  283 VVFFERNGLRHGEFTLRFDPEEEKVIELAWNS-------------DSEILAVWLEDR-VQLWTRS---------------  333 (928)
T ss_pred             EEEEecCCcEeeeEecCCCCCCceeeEEEECC-------------CCCEEEEEecCC-ceEEEee---------------
Confidence            444544443322232  234567899999998             356799987666 9999922               


Q ss_pred             CccceeEEEEEEEeecccccCCCCCCeEEEeeccccceeecc
Q 000080          301 KTIRRSFCVGAIIEINQALNGALGMDIVITWAKEIRCMFETG  342 (2389)
Q Consensus       301 ~~~~~sF~vaA~I~~~~~~~~~l~~~~~v~W~~~~~~vf~~~  342 (2389)
                         .-|+++=-.|..+...    +. ..++|=.++...+-..
T Consensus       334 ---NYHWYLKqei~~~~~~----~~-~~~~Wdpe~p~~L~v~  367 (928)
T PF04762_consen  334 ---NYHWYLKQEIRFSSSE----SV-NFVKWDPEKPLRLHVL  367 (928)
T ss_pred             ---CCEEEEEEEEEccCCC----CC-CceEECCCCCCEEEEE
Confidence               2788888888855511    11 1388888876654444


No 244
>KOG1272 consensus WD40-repeat-containing subunit of the 18S rRNA processing complex [RNA processing and modification]
Probab=97.66  E-value=6.7e-05  Score=92.62  Aligned_cols=109  Identities=20%  Similarity=0.337  Sum_probs=83.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .+..+.-+|-...+-.|..+|||.||.....+.+..+.   .       |.+.|++||+.|+|+++||++.|+.|++||+
T Consensus       253 ~~~vm~qNP~NaVih~GhsnGtVSlWSP~skePLvKiL---c-------H~g~V~siAv~~~G~YMaTtG~Dr~~kIWDl  322 (545)
T KOG1272|consen  253 RTDVMKQNPYNAVIHLGHSNGTVSLWSPNSKEPLVKIL---C-------HRGPVSSIAVDRGGRYMATTGLDRKVKIWDL  322 (545)
T ss_pred             ccchhhcCCccceEEEcCCCceEEecCCCCcchHHHHH---h-------cCCCcceEEECCCCcEEeecccccceeEeee
Confidence            34667888988899999999999999987777654432   3       5688999999999999999999999999999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +.-.     .+.++.- ...+..++||. - .+||.+    .+..|.||.=
T Consensus       323 R~~~-----ql~t~~t-p~~a~~ls~Sq-k-glLA~~----~G~~v~iw~d  361 (545)
T KOG1272|consen  323 RNFY-----QLHTYRT-PHPASNLSLSQ-K-GLLALS----YGDHVQIWKD  361 (545)
T ss_pred             cccc-----ccceeec-CCCcccccccc-c-cceeee----cCCeeeeehh
Confidence            9752     2222211 24567789996 4 456642    5678999973


No 245
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=97.61  E-value=0.00021  Score=90.13  Aligned_cols=130  Identities=22%  Similarity=0.384  Sum_probs=93.0

Q ss_pred             CCeeEEEEcCCCCCCCcEEEecC---CeEEEEeeCCCCCCCCccceeeEEe-cccceEEEEeecCCCCeEEEEecc----
Q 000080           95 LPVTSISWSPETPSIGQLAAASE---NCIFVFAHDSASSKGSFCWSQNAIL-VQGTKVEAIEWTGSGDGIVAGGME----  166 (2389)
Q Consensus        95 ~dVk~VaWSPd~~~~GeIaASyD---ntIRVw~~d~~~~kgd~~W~~~~tL-~hssTV~sIAWSpdG~rLaSggdD----  166 (2389)
                      .+|-+|.|+|.   +.|.++.|+   -+|-||...     ++      -.+ ..+++=.++-|||.|+.|+-+|++    
T Consensus       271 GPVhdv~W~~s---~~EF~VvyGfMPAkvtifnlr-----~~------~v~df~egpRN~~~fnp~g~ii~lAGFGNL~G  336 (566)
T KOG2315|consen  271 GPVHDVTWSPS---GREFAVVYGFMPAKVTIFNLR-----GK------PVFDFPEGPRNTAFFNPHGNIILLAGFGNLPG  336 (566)
T ss_pred             CCceEEEECCC---CCEEEEEEecccceEEEEcCC-----CC------EeEeCCCCCccceEECCCCCEEEEeecCCCCC
Confidence            58999999997   778888876   788888765     11      111 246677889999999999999996    


Q ss_pred             -eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCC
Q 000080          167 -TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQP  244 (2389)
Q Consensus       167 -V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qd  244 (2389)
                       +.||+..+  .+++.+.... .-+++  .|||||. |.||....|+++.      +.+-||-++|..-+.+.   -++.
T Consensus       337 ~mEvwDv~n--~K~i~~~~a~-~tt~~--eW~PdGe~flTATTaPRlrvd------Ng~KiwhytG~~l~~~~---f~sE  402 (566)
T KOG2315|consen  337 DMEVWDVPN--RKLIAKFKAA-NTTVF--EWSPDGEYFLTATTAPRLRVD------NGIKIWHYTGSLLHEKM---FKSE  402 (566)
T ss_pred             ceEEEeccc--hhhccccccC-CceEE--EEcCCCcEEEEEeccccEEec------CCeEEEEecCceeehhh---hhHh
Confidence             88999776  7777654432 23444  8999999 8888776565555      45667777766522221   1225


Q ss_pred             eeEEEecc
Q 000080          245 VSMVQWRP  252 (2389)
Q Consensus       245 Vn~V~W~P  252 (2389)
                      -..|.|+|
T Consensus       403 L~qv~W~P  410 (566)
T KOG2315|consen  403 LLQVEWRP  410 (566)
T ss_pred             Hhheeeee
Confidence            66799999


No 246
>PF02239 Cytochrom_D1:  Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=97.61  E-value=0.00073  Score=84.02  Aligned_cols=129  Identities=17%  Similarity=0.183  Sum_probs=85.8

Q ss_pred             EEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee
Q 000080         2234 FLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES 2313 (2389)
Q Consensus      2234 LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t 2313 (2389)
                      +++-..+++|.+.|..+.+.+.++..         |+ +.-..++|+|||+++.+++.||+|.++|+.++     +.+.+
T Consensus         9 ~V~~~~~~~v~viD~~t~~~~~~i~~---------~~-~~h~~~~~s~Dgr~~yv~~rdg~vsviD~~~~-----~~v~~   73 (369)
T PF02239_consen    9 YVVERGSGSVAVIDGATNKVVARIPT---------GG-APHAGLKFSPDGRYLYVANRDGTVSVIDLATG-----KVVAT   73 (369)
T ss_dssp             EEEEGGGTEEEEEETTT-SEEEEEE----------ST-TEEEEEE-TT-SSEEEEEETTSEEEEEETTSS-----SEEEE
T ss_pred             EEEecCCCEEEEEECCCCeEEEEEcC---------CC-CceeEEEecCCCCEEEEEcCCCeEEEEECCcc-----cEEEE
Confidence            45677899999999999998888741         11 22245789999999999999999999999986     34555


Q ss_pred             eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEee-------cCcEEEEeecccch-hhhc
Q 000080         2314 CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCH-------EGLYDLFLPLKLLN-FALS 2383 (2389)
Q Consensus      2314 l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH-------~~~V~svA~~~~~~-~~~s 2383 (2389)
                      ... .....++++|+ ||++++++.  -.+++|.|+|+  .+.+.++.+...       +.++..+-.++..+ |+++
T Consensus        74 i~~-G~~~~~i~~s~-DG~~~~v~n--~~~~~v~v~D~--~tle~v~~I~~~~~~~~~~~~Rv~aIv~s~~~~~fVv~  145 (369)
T PF02239_consen   74 IKV-GGNPRGIAVSP-DGKYVYVAN--YEPGTVSVIDA--ETLEPVKTIPTGGMPVDGPESRVAAIVASPGRPEFVVN  145 (369)
T ss_dssp             EE--SSEEEEEEE---TTTEEEEEE--EETTEEEEEET--TT--EEEEEE--EE-TTTS---EEEEEE-SSSSEEEEE
T ss_pred             Eec-CCCcceEEEcC-CCCEEEEEe--cCCCceeEecc--ccccceeecccccccccccCCCceeEEecCCCCEEEEE
Confidence            443 34567899999 999999864  47899999997  455667766432       23556665566555 5544


No 247
>PF00400 WD40:  WD domain, G-beta repeat;  InterPro: IPR019781 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events.; PDB: 2ZKQ_a 3CFV_B 3CFS_B 1PEV_A 1NR0_A 1VYH_T 3RFH_A 3O2Z_T 3FRX_C 3U5G_g ....
Probab=97.61  E-value=0.00013  Score=61.44  Aligned_cols=38  Identities=21%  Similarity=0.385  Sum_probs=34.7

Q ss_pred             ccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2309 RPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2309 k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      +++.++.+|+..|++++|+| ++++|||+   +.|++|+|||
T Consensus         2 ~~~~~~~~h~~~i~~i~~~~-~~~~~~s~---~~D~~i~vwd   39 (39)
T PF00400_consen    2 KCVRTFRGHSSSINSIAWSP-DGNFLASG---SSDGTIRVWD   39 (39)
T ss_dssp             EEEEEEESSSSSEEEEEEET-TSSEEEEE---ETTSEEEEEE
T ss_pred             eEEEEEcCCCCcEEEEEEec-ccccceee---CCCCEEEEEC
Confidence            46788999999999999999 89999997   4999999998


No 248
>PF02239 Cytochrom_D1:  Cytochrome D1 heme domain; PDB: 1NNO_B 1HZU_A 1N15_B 1N50_A 1GJQ_A 1BL9_B 1NIR_B 1N90_B 1HZV_A 1AOQ_A ....
Probab=97.55  E-value=0.0022  Score=79.84  Aligned_cols=136  Identities=13%  Similarity=0.057  Sum_probs=84.7

Q ss_pred             EEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCcEEEeeCCC
Q 000080         2224 AFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGTVCTWQLEV 2302 (2389)
Q Consensus      2224 sVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgTVkLWDl~t 2302 (2389)
                      .+.|+|||+++..++.|+.|.++|+.+++.+++.++  |         ..-+.+++||||++++++. .+++|.++|.++
T Consensus        41 ~~~~s~Dgr~~yv~~rdg~vsviD~~~~~~v~~i~~--G---------~~~~~i~~s~DG~~~~v~n~~~~~v~v~D~~t  109 (369)
T PF02239_consen   41 GLKFSPDGRYLYVANRDGTVSVIDLATGKVVATIKV--G---------GNPRGIAVSPDGKYVYVANYEPGTVSVIDAET  109 (369)
T ss_dssp             EEE-TT-SSEEEEEETTSEEEEEETTSSSEEEEEE---S---------SEEEEEEE--TTTEEEEEEEETTEEEEEETTT
T ss_pred             EEEecCCCCEEEEEcCCCeEEEEECCcccEEEEEec--C---------CCcceEEEcCCCCEEEEEecCCCceeEecccc
Confidence            368999999999999999999999999999988862  2         3468999999999888765 789999999998


Q ss_pred             CCccCcccceeeee-------cCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeecCcEEEE
Q 000080         2303 GGRSNVRPMESCLC-------FSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHEGLYDLF 2372 (2389)
Q Consensus      2303 ggrs~~k~l~tl~g-------Hs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~~~V~sv 2372 (2389)
                      .     +++++...       -+..+..|..+| .+. ++++-   -+-+.|.+=|+.  ..+.+  ..+. -...-.-.
T Consensus       110 l-----e~v~~I~~~~~~~~~~~~Rv~aIv~s~-~~~~fVv~l---kd~~~I~vVdy~--d~~~~~~~~i~-~g~~~~D~  177 (369)
T PF02239_consen  110 L-----EPVKTIPTGGMPVDGPESRVAAIVASP-GRPEFVVNL---KDTGEIWVVDYS--DPKNLKVTTIK-VGRFPHDG  177 (369)
T ss_dssp             -------EEEEEE--EE-TTTS---EEEEEE-S-SSSEEEEEE---TTTTEEEEEETT--TSSCEEEEEEE---TTEEEE
T ss_pred             c-----cceeecccccccccccCCCceeEEecC-CCCEEEEEE---ccCCeEEEEEec--cccccceeeec-cccccccc
Confidence            5     34444332       234677888888 555 55543   123444444653  22222  3332 22333456


Q ss_pred             eecccchhhh
Q 000080         2373 LPLKLLNFAL 2382 (2389)
Q Consensus      2373 A~~~~~~~~~ 2382 (2389)
                      .+.|+|++.+
T Consensus       178 ~~dpdgry~~  187 (369)
T PF02239_consen  178 GFDPDGRYFL  187 (369)
T ss_dssp             EE-TTSSEEE
T ss_pred             ccCcccceee
Confidence            7788887654


No 249
>PRK00178 tolB translocation protein TolB; Provisional
Probab=97.49  E-value=0.001  Score=83.09  Aligned_cols=118  Identities=15%  Similarity=0.124  Sum_probs=80.1

Q ss_pred             cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC---CcEEEeeCCCCCccCcccceeeeecC
Q 000080         2242 HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD---GTVCTWQLEVGGRSNVRPMESCLCFS 2318 (2389)
Q Consensus      2242 TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D---gTVkLWDl~tggrs~~k~l~tl~gHs 2318 (2389)
                      .|.++|.. |...+.+.          .+...+.+.+|||||++||..+.+   ..|.+||+.++..   +.+..   ..
T Consensus       180 ~l~~~d~~-g~~~~~l~----------~~~~~~~~p~wSpDG~~la~~s~~~~~~~l~~~~l~~g~~---~~l~~---~~  242 (430)
T PRK00178        180 TLQRSDYD-GARAVTLL----------QSREPILSPRWSPDGKRIAYVSFEQKRPRIFVQNLDTGRR---EQITN---FE  242 (430)
T ss_pred             EEEEECCC-CCCceEEe----------cCCCceeeeeECCCCCEEEEEEcCCCCCEEEEEECCCCCE---EEccC---CC
Confidence            58888875 44333332          123668999999999999987754   3688999988631   23322   33


Q ss_pred             CCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhh
Q 000080         2319 SHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2319 ~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      +.+...+|+| ||+.||.+.  +.++  .|.+||+  .+ +.++.+..+.......+++|+|++++
T Consensus       243 g~~~~~~~Sp-DG~~la~~~--~~~g~~~Iy~~d~--~~-~~~~~lt~~~~~~~~~~~spDg~~i~  302 (430)
T PRK00178        243 GLNGAPAWSP-DGSKLAFVL--SKDGNPEIYVMDL--AS-RQLSRVTNHPAIDTEPFWGKDGRTLY  302 (430)
T ss_pred             CCcCCeEECC-CCCEEEEEE--ccCCCceEEEEEC--CC-CCeEEcccCCCCcCCeEECCCCCEEE
Confidence            3455689999 999888532  2333  5777787  23 34566777777777888999998764


No 250
>PF10282 Lactonase:  Lactonase, 7-bladed beta-propeller;  InterPro: IPR019405  6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types.  This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.48  E-value=0.0043  Score=76.06  Aligned_cols=127  Identities=12%  Similarity=0.200  Sum_probs=85.7

Q ss_pred             EEEEEEcCCCCeE-EEEeCCCcEEEeecC--CCce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCE-EEEEeCCCcE
Q 000080         2222 TRAFSSHPLRPFF-LVGSSNTHIYLWEFG--KDKA--TATYGVLPAANVPPPYALASISALQFDHYGHR-FASAALDGTV 2295 (2389)
Q Consensus      2222 VrsVAFsPdG~~L-ASGS~DgTIRLWDl~--tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~-LASgS~DgTV 2295 (2389)
                      =|.++|||||+++ +..-.+++|.++++.  +|+.  +++...++..   ..+ ......|++||||++ ++|...+++|
T Consensus       194 PRh~~f~pdg~~~Yv~~e~s~~v~v~~~~~~~g~~~~~~~~~~~~~~---~~~-~~~~~~i~ispdg~~lyvsnr~~~sI  269 (345)
T PF10282_consen  194 PRHLAFSPDGKYAYVVNELSNTVSVFDYDPSDGSLTEIQTISTLPEG---FTG-ENAPAEIAISPDGRFLYVSNRGSNSI  269 (345)
T ss_dssp             EEEEEE-TTSSEEEEEETTTTEEEEEEEETTTTEEEEEEEEESCETT---SCS-SSSEEEEEE-TTSSEEEEEECTTTEE
T ss_pred             CcEEEEcCCcCEEEEecCCCCcEEEEeecccCCceeEEEEeeecccc---ccc-cCCceeEEEecCCCEEEEEeccCCEE
Confidence            3888999999965 556688999999998  5543  3333222221   011 136899999999986 5556688999


Q ss_pred             EEeeCCC-CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080         2296 CTWQLEV-GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus      2296 kLWDl~t-ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
                      .++++.. .+  .++.+.........-+.++|+| ||++|+.+.  -.+++|.++++...+|.
T Consensus       270 ~vf~~d~~~g--~l~~~~~~~~~G~~Pr~~~~s~-~g~~l~Va~--~~s~~v~vf~~d~~tG~  327 (345)
T PF10282_consen  270 SVFDLDPATG--TLTLVQTVPTGGKFPRHFAFSP-DGRYLYVAN--QDSNTVSVFDIDPDTGK  327 (345)
T ss_dssp             EEEEECTTTT--TEEEEEEEEESSSSEEEEEE-T-TSSEEEEEE--TTTTEEEEEEEETTTTE
T ss_pred             EEEEEecCCC--ceEEEEEEeCCCCCccEEEEeC-CCCEEEEEe--cCCCeEEEEEEeCCCCc
Confidence            9999942 22  2345555554455688999999 999999875  47788999987534444


No 251
>KOG1587 consensus Cytoplasmic dynein intermediate chain [Cytoskeleton]
Probab=97.48  E-value=0.00034  Score=90.63  Aligned_cols=116  Identities=15%  Similarity=0.210  Sum_probs=88.4

Q ss_pred             ceeEEEEEEcCCCCeEEEEeCCCcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080         2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus      2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
                      ..+|++|.++|=++-+...+.|.+||||.-. .-..+..+.   .       +.+.|++|++||-- ..||++..||.+-
T Consensus       398 ~g~v~~v~~nPF~~k~fls~gDW~vriWs~~~~~~Pl~~~~---~-------~~~~v~~vaWSptrpavF~~~d~~G~l~  467 (555)
T KOG1587|consen  398 IGPVYAVSRNPFYPKNFLSVGDWTVRIWSEDVIASPLLSLD---S-------SPDYVTDVAWSPTRPAVFATVDGDGNLD  467 (555)
T ss_pred             CcceEeeecCCCccceeeeeccceeEeccccCCCCcchhhh---h-------ccceeeeeEEcCcCceEEEEEcCCCcee
Confidence            3578999999988744444449999999975 334443332   1       34779999999996 7999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +||+...   ...|+.+..-+....+.+.+++ +|+.||.|   ...|+|.+|++
T Consensus       468 iWDLl~~---~~~Pv~s~~~~~~~l~~~~~s~-~g~~lavG---d~~G~~~~~~l  515 (555)
T KOG1587|consen  468 IWDLLQD---DEEPVLSQKVCSPALTRVRWSP-NGKLLAVG---DANGTTHILKL  515 (555)
T ss_pred             hhhhhcc---ccCCcccccccccccceeecCC-CCcEEEEe---cCCCcEEEEEc
Confidence            9999864   3467777655555555666776 89999986   48899999998


No 252
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=97.46  E-value=0.00039  Score=89.19  Aligned_cols=194  Identities=16%  Similarity=0.201  Sum_probs=120.0

Q ss_pred             CcceeecCCCCCCeEEEEecCCcEEEEeCCCCccccccc--ccccceeeeeccCCC-CCeeEEEEcCCCCCCCc----EE
Q 000080           41 TSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEAL--IGPIFRQVFALSDNS-LPVTSISWSPETPSIGQ----LA  113 (2389)
Q Consensus        41 ~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~--~~p~~~Qviegh~d~-~dVk~VaWSPd~~~~Ge----Ia  113 (2389)
                      .+|.+-.|.  | .=||-|+.-++.|.+|++|...+..+  +-|.+.+-.+-+-|. -|.|.|.|||+    .-    +|
T Consensus        27 ~~a~si~p~--g-rdi~lAsr~gl~i~dld~p~~ppr~l~h~tpw~vad~qws~h~a~~~wiVsts~q----kaiiwnlA   99 (1081)
T KOG0309|consen   27 FNAVSINPS--G-RDIVLASRQGLYIIDLDDPFTPPRWLHHITPWQVADVQWSPHPAKPYWIVSTSNQ----KAIIWNLA   99 (1081)
T ss_pred             ccceeeccc--c-chhhhhhhcCeEEEeccCCCCCceeeeccCcchhcceecccCCCCceeEEecCcc----hhhhhhhh
Confidence            456666676  5 35788999999999999999887653  333333322222222 34555555553    22    22


Q ss_pred             EecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCC-eEEEEecc--eEEeeccCCcEE-EEEEeeccccc
Q 000080          114 AASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGD-GIVAGGME--TVLWKKKNTLWE-IAWKFKENYPQ  189 (2389)
Q Consensus       114 ASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~-rLaSggdD--V~IW~~~~s~We-cvwt~~~~~~~  189 (2389)
                      +|+++.|-++-+-                 |++.|-++-|+|+-. -|++|+-|  |..|+..+...- .+|.....+..
T Consensus       100 ~ss~~aIef~lhg-----------------hsraitd~n~~~q~pdVlatcsvdt~vh~wd~rSp~~p~ys~~~w~s~as  162 (1081)
T KOG0309|consen  100 KSSSNAIEFVLHG-----------------HSRAITDINFNPQHPDVLATCSVDTYVHAWDMRSPHRPFYSTSSWRSAAS  162 (1081)
T ss_pred             cCCccceEEEEec-----------------CccceeccccCCCCCcceeeccccccceeeeccCCCcceeeeecccccCc
Confidence            3445555444432                 788999999999875 67799988  899996543321 11111111111


Q ss_pred             eEEEEeecC-CCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccC
Q 000080          190 NLVSATWSI-EGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQR  267 (2389)
Q Consensus       190 ~ivsvaWSp-dG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~  267 (2389)
                         .|.|+- ++. +|+.-+             +-++||.......-.+....|...||++..+-            ...
T Consensus       163 ---qVkwnyk~p~vlasshg-------------~~i~vwd~r~gs~pl~s~K~~vs~vn~~~fnr------------~~~  214 (1081)
T KOG0309|consen  163 ---QVKWNYKDPNVLASSHG-------------NDIFVWDLRKGSTPLCSLKGHVSSVNSIDFNR------------FKY  214 (1081)
T ss_pred             ---eeeecccCcchhhhccC-------------CceEEEeccCCCcceEEecccceeeehHHHhh------------hhh
Confidence               347774 455 775533             22446643323333445556999999999986            234


Q ss_pred             ceEEeeecCCeEEEEEeec
Q 000080          268 HVLLTCCLDGTVRLWCEMD  286 (2389)
Q Consensus       268 nILAScSdDgTVRLW~e~d  286 (2389)
                      ..++||+-|+|||.|++.-
T Consensus       215 s~~~s~~~d~tvkfw~y~k  233 (1081)
T KOG0309|consen  215 SEIMSSSNDGTVKFWDYSK  233 (1081)
T ss_pred             hhhcccCCCCceeeecccc
Confidence            5699999999999999874


No 253
>KOG3881 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.42  E-value=0.0009  Score=81.93  Aligned_cols=151  Identities=13%  Similarity=0.116  Sum_probs=113.8

Q ss_pred             EEEEEEcCCCC-eEEEEeCC--CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEE
Q 000080         2222 TRAFSSHPLRP-FFLVGSSN--THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVC 2296 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~D--gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVk 2296 (2389)
                      +..+--+|.-+ ++|+|+-.  ..+++||+.+++.+-+...+|-.+ ...----|++++.|-|.  -..||++..-+.||
T Consensus       151 ~~~~r~~~~~p~Iva~GGke~~n~lkiwdle~~~qiw~aKNvpnD~-L~LrVPvW~tdi~Fl~g~~~~~fat~T~~hqvR  229 (412)
T KOG3881|consen  151 LYDVRQTDTDPYIVATGGKENINELKIWDLEQSKQIWSAKNVPNDR-LGLRVPVWITDIRFLEGSPNYKFATITRYHQVR  229 (412)
T ss_pred             eeeeccCCCCCceEecCchhcccceeeeecccceeeeeccCCCCcc-ccceeeeeeccceecCCCCCceEEEEecceeEE
Confidence            45566677666 45669988  889999998875543332222111 00001157889999988  89999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeecCcEEEEeec
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~~V~svA~~ 2375 (2389)
                      ++|.+.+ |   +|+.++.--+..+.+++.-| +|+.|.+|   ..-+.+...|+  ..++...+ +.|-++.+++|--+
T Consensus       230 ~YDt~~q-R---RPV~~fd~~E~~is~~~l~p-~gn~Iy~g---n~~g~l~~FD~--r~~kl~g~~~kg~tGsirsih~h  299 (412)
T KOG3881|consen  230 LYDTRHQ-R---RPVAQFDFLENPISSTGLTP-SGNFIYTG---NTKGQLAKFDL--RGGKLLGCGLKGITGSIRSIHCH  299 (412)
T ss_pred             EecCccc-C---cceeEeccccCcceeeeecC-CCcEEEEe---cccchhheecc--cCceeeccccCCccCCcceEEEc
Confidence            9999987 4   68888777789999999999 99999986   35678999998  35555555 88889999999888


Q ss_pred             ccchhhhc
Q 000080         2376 KLLNFALS 2383 (2389)
Q Consensus      2376 ~~~~~~~s 2383 (2389)
                      |.+.++.|
T Consensus       300 p~~~~las  307 (412)
T KOG3881|consen  300 PTHPVLAS  307 (412)
T ss_pred             CCCceEEe
Confidence            88877665


No 254
>KOG2315 consensus Predicted translation initiation factor related to eIF-3a [Translation, ribosomal structure and biogenesis]
Probab=97.33  E-value=0.0052  Score=78.15  Aligned_cols=225  Identities=18%  Similarity=0.179  Sum_probs=142.2

Q ss_pred             CCCCCCCCCCcccccCCccCCCc---cccCCCCcccccCCcccccccccCCCccccCccccccccccccceeeccccccc
Q 000080         2129 DWPQNGWAGSESTPVPTFVSPGV---GLGSNKGAHLGLGGATIGVGSLARPGRDLTGGLAFGIPGYAGIGASALGWETQD 2205 (2389)
Q Consensus      2129 ~~~~~~~~~~~s~p~~~~~s~~~---g~~~~~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~g~~~~~Asg~~~d~~~ 2205 (2389)
                      +| .--|.-+||-- ---|+-.|   -+++.++-.-.|....|++..+...+..-.  .|+=+||..|+-|++--|.-.+
T Consensus       128 ~W-~~qfs~dEsl~-arlv~nev~f~~~~~f~~~~~kl~~~~i~~f~lSpgp~~~~--vAvyvPe~kGaPa~vri~~~~~  203 (566)
T KOG2315|consen  128 GW-VPQFSIDESLA-ARLVSNEVQFYDLGSFKTIQHKLSVSGITMLSLSPGPEPPF--VAVYVPEKKGAPASVRIYKYPE  203 (566)
T ss_pred             Cc-ccccccchhhh-hhhhcceEEEEecCCccceeeeeeccceeeEEecCCCCCce--EEEEccCCCCCCcEEEEecccc
Confidence            35 44566677622 11122222   234566666666666666666655433332  3667899999988884443331


Q ss_pred             cccccccCCCCc--CceeEEEEEEcCCCC---eEEEEeCC---------CcEEEeecCCCceeeEecccCCCCCCCCCCC
Q 000080         2206 DFEDYVDPPATV--ENISTRAFSSHPLRP---FFLVGSSN---------THIYLWEFGKDKATATYGVLPAANVPPPYAL 2271 (2389)
Q Consensus      2206 ~~~~~~d~~atv--~ni~VrsVAFsPdG~---~LASGS~D---------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~ 2271 (2389)
                      ...  ..+++.-  =-..--.+.|++-|.   .|++.--|         .++++-++...++...+.   .        .
T Consensus       204 ~~~--~~~~a~ksFFkadkvqm~WN~~gt~LLvLastdVDktn~SYYGEq~Lyll~t~g~s~~V~L~---k--------~  270 (566)
T KOG2315|consen  204 EGQ--HQPVANKSFFKADKVQMKWNKLGTALLVLASTDVDKTNASYYGEQTLYLLATQGESVSVPLL---K--------E  270 (566)
T ss_pred             ccc--cchhhhccccccceeEEEeccCCceEEEEEEEeecCCCccccccceEEEEEecCceEEEecC---C--------C
Confidence            111  0111110  000112456777777   23333334         478888886334443332   1        3


Q ss_pred             CCEEEEEECCCCCEEEEEeC--CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2272 ASISALQFDHYGHRFASAAL--DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~--DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      +.|++|.|||+|+-||...+  =-+|.+.|++-      .++..+  -++.=+++-|+| .|++|+-||||..-|.|.+|
T Consensus       271 GPVhdv~W~~s~~EF~VvyGfMPAkvtifnlr~------~~v~df--~egpRN~~~fnp-~g~ii~lAGFGNL~G~mEvw  341 (566)
T KOG2315|consen  271 GPVHDVTWSPSGREFAVVYGFMPAKVTIFNLRG------KPVFDF--PEGPRNTAFFNP-HGNIILLAGFGNLPGDMEVW  341 (566)
T ss_pred             CCceEEEECCCCCEEEEEEecccceEEEEcCCC------CEeEeC--CCCCccceEECC-CCCEEEEeecCCCCCceEEE
Confidence            77999999999999988664  57889999973      355554  234556788999 99999999999999999999


Q ss_pred             eCCCCCCCceEEEEeecCcEEEEeecccchhhhc
Q 000080         2350 DTLAPPTSSRASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                      |+  .+.+++.++.+-  +.+.+.-+|+|.|+|.
T Consensus       342 Dv--~n~K~i~~~~a~--~tt~~eW~PdGe~flT  371 (566)
T KOG2315|consen  342 DV--PNRKLIAKFKAA--NTTVFEWSPDGEYFLT  371 (566)
T ss_pred             ec--cchhhccccccC--CceEEEEcCCCcEEEE
Confidence            98  467778887754  3678899999999986


No 255
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=97.32  E-value=0.00063  Score=84.81  Aligned_cols=117  Identities=11%  Similarity=0.153  Sum_probs=95.2

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--CCEEEEEeCCCcEEEee
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--GHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--G~~LASgS~DgTVkLWD 2299 (2389)
                      |.+|.|+..|..|+|||+|.+|-+|||.+++.+..|.         .||...|.+-.|=|.  .+.+++.+.||.||+=.
T Consensus       145 VntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~~~l~f~---------SGH~~NvfQaKFiP~s~d~ti~~~s~dgqvr~s~  215 (559)
T KOG1334|consen  145 VNTVHFNQRGDVLASGSDDLQVVVWDWVSGSPKLSFE---------SGHCNNVFQAKFIPFSGDRTIVTSSRDGQVRVSE  215 (559)
T ss_pred             cceeeecccCceeeccCccceEEeehhhccCcccccc---------cccccchhhhhccCCCCCcCceeccccCceeeee
Confidence            4677999999999999999999999999998877764         378888999999776  48999999999999876


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      +-..+  ...-...+..|.++|.-+|.-|++-..+.|+|   +|+.|.=-|+.
T Consensus       216 i~~t~--~~e~t~rl~~h~g~vhklav~p~sp~~f~S~g---eD~~v~~~Dlr  263 (559)
T KOG1334|consen  216 ILETG--YVENTKRLAPHEGPVHKLAVEPDSPKPFLSCG---EDAVVFHIDLR  263 (559)
T ss_pred             ecccc--ceecceecccccCccceeeecCCCCCcccccc---cccceeeeeec
Confidence            64432  11223445568899999999997777888874   99999988873


No 256
>KOG3914 consensus WD repeat protein WDR4 [Function unknown]
Probab=97.29  E-value=0.00037  Score=85.48  Aligned_cols=73  Identities=12%  Similarity=0.167  Sum_probs=61.6

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      +..|+++||+++|+++-.|.+||+=.+..---+.+|         ..||...|..++.-++- .|+|||+|+||++||++
T Consensus       154 l~dVavS~D~~~IitaDRDEkIRvs~ypa~f~Iesf---------clGH~eFVS~isl~~~~-~LlS~sGD~tlr~Wd~~  223 (390)
T KOG3914|consen  154 LLDVAVSPDDQFIITADRDEKIRVSRYPATFVIESF---------CLGHKEFVSTISLTDNY-LLLSGSGDKTLRLWDIT  223 (390)
T ss_pred             hheeeecCCCCEEEEecCCceEEEEecCcccchhhh---------ccccHhheeeeeeccCc-eeeecCCCCcEEEEecc
Confidence            478899999999999999999999776433334444         36899999999998775 59999999999999999


Q ss_pred             CCC
Q 000080         2302 VGG 2304 (2389)
Q Consensus      2302 tgg 2304 (2389)
                      +|.
T Consensus       224 sgk  226 (390)
T KOG3914|consen  224 SGK  226 (390)
T ss_pred             cCC
Confidence            983


No 257
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=97.28  E-value=0.0033  Score=87.48  Aligned_cols=119  Identities=12%  Similarity=0.091  Sum_probs=82.1

Q ss_pred             EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccC--CCCCCCCC---------CCCCEEEEEECCCCCEEEEEe
Q 000080         2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLP--AANVPPPY---------ALASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus      2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~--gh~~p~~G---------H~~~V~sVaFSPDG~~LASgS 2290 (2389)
                      +.|+|+|+|. ++++-+.++.|++||+.++........-+  ..+.-..|         ....-..|+|+|||+.+++-+
T Consensus       743 ~GIavspdG~~LYVADs~n~~Irv~D~~tg~~~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~dG~LYVADs  822 (1057)
T PLN02919        743 SGISLSPDLKELYIADSESSSIRALDLKTGGSRLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAKDGQIYVADS  822 (1057)
T ss_pred             cEEEEeCCCCEEEEEECCCCeEEEEECCCCcEEEEEecccccCcccccccCCCCchhhhhccCCceeeEeCCCcEEEEEC
Confidence            6679999998 67788889999999998775321110000  00000000         111236899999999999999


Q ss_pred             CCCcEEEeeCCCCCccCcccceeeee--------------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2291 LDGTVCTWQLEVGGRSNVRPMESCLC--------------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggrs~~k~l~tl~g--------------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      .+++|++||.+++.      +.++.+              +-.....|++++ +|+++++-   +.+++|++||+
T Consensus       823 ~N~rIrviD~~tg~------v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~-dG~lyVaD---t~Nn~Irvid~  887 (1057)
T PLN02919        823 YNHKIKKLDPATKR------VTTLAGTGKAGFKDGKALKAQLSEPAGLALGE-NGRLFVAD---TNNSLIRYLDL  887 (1057)
T ss_pred             CCCEEEEEECCCCe------EEEEeccCCcCCCCCcccccccCCceEEEEeC-CCCEEEEE---CCCCEEEEEEC
Confidence            99999999998752      122222              223567899999 99988874   68899999997


No 258
>PRK04043 tolB translocation protein TolB; Provisional
Probab=97.26  E-value=0.019  Score=72.81  Aligned_cols=200  Identities=7%  Similarity=-0.022  Sum_probs=104.0

Q ss_pred             cceeecCCCCCCeEEEEecC----CcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--
Q 000080           42 STIDWLPDFAGYSWVAYGAS----SLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA--  115 (2389)
Q Consensus        42 ~ai~wlpD~~G~~~vAYasg----~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--  115 (2389)
                      -...|+||  |...++|.+-    ..|.+..+..   + +..      ++.+..+   .+...+||||   +..||..  
T Consensus       191 ~~p~wSpD--G~~~i~y~s~~~~~~~Iyv~dl~t---g-~~~------~lt~~~g---~~~~~~~SPD---G~~la~~~~  252 (419)
T PRK04043        191 IFPKWANK--EQTAFYYTSYGERKPTLYKYNLYT---G-KKE------KIASSQG---MLVVSDVSKD---GSKLLLTMA  252 (419)
T ss_pred             EeEEECCC--CCcEEEEEEccCCCCEEEEEECCC---C-cEE------EEecCCC---cEEeeEECCC---CCEEEEEEc
Confidence            36899999  6434666422    3355555322   3 222      3333222   4677899998   6677743  


Q ss_pred             cCCeEEEEeeCCCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc---eEEe--eccCCcEEEEEEeeccccc
Q 000080          116 SENCIFVFAHDSASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME---TVLW--KKKNTLWEIAWKFKENYPQ  189 (2389)
Q Consensus       116 yDntIRVw~~d~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD---V~IW--~~~~s~Wecvwt~~~~~~~  189 (2389)
                      .++.-.||--+.  ..+  .+.   .++ +......-.|+|||++|+-.++.   .+||  +..++..+.+.. .+.  .
T Consensus       253 ~~g~~~Iy~~dl--~~g--~~~---~LT~~~~~d~~p~~SPDG~~I~F~Sdr~g~~~Iy~~dl~~g~~~rlt~-~g~--~  322 (419)
T PRK04043        253 PKGQPDIYLYDT--NTK--TLT---QITNYPGIDVNGNFVEDDKRIVFVSDRLGYPNIFMKKLNSGSVEQVVF-HGK--N  322 (419)
T ss_pred             cCCCcEEEEEEC--CCC--cEE---EcccCCCccCccEECCCCCEEEEEECCCCCceEEEEECCCCCeEeCcc-CCC--c
Confidence            234445554431  112  121   233 22223356899999999977763   3444  445566654431 111  1


Q ss_pred             eEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCc
Q 000080          190 NLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRH  268 (2389)
Q Consensus       190 ~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~n  268 (2389)
                         ..+|||||. +|-.+....-.   ......-+++..-++.. . .....+ ......+|+|        ||+.    
T Consensus       323 ---~~~~SPDG~~Ia~~~~~~~~~---~~~~~~~I~v~d~~~g~-~-~~LT~~-~~~~~p~~SP--------DG~~----  381 (419)
T PRK04043        323 ---NSSVSTYKNYIVYSSRETNNE---FGKNTFNLYLISTNSDY-I-RRLTAN-GVNQFPRFSS--------DGGS----  381 (419)
T ss_pred             ---CceECCCCCEEEEEEcCCCcc---cCCCCcEEEEEECCCCC-e-EECCCC-CCcCCeEECC--------CCCE----
Confidence               238999999 77666531100   00001123443222221 1 211122 2334689999        7666    


Q ss_pred             eEEeeecCCeEEEEEeecCCcc
Q 000080          269 VLLTCCLDGTVRLWCEMDSGKT  290 (2389)
Q Consensus       269 ILAScSdDgTVRLW~e~d~Gk~  290 (2389)
                      |+.+....+.-.||...-.|..
T Consensus       382 I~f~~~~~~~~~L~~~~l~g~~  403 (419)
T PRK04043        382 IMFIKYLGNQSALGIIRLNYNK  403 (419)
T ss_pred             EEEEEccCCcEEEEEEecCCCe
Confidence            4455545677788888866654


No 259
>PF10282 Lactonase:  Lactonase, 7-bladed beta-propeller;  InterPro: IPR019405  6-phosphogluconolactonases (6PGL) 3.1.1.31 from EC, which hydrolyses 6-phosphogluconolactone to 6-phosphogluconate is opne of the enzymes in the pentose phosphate pathway. Two families of structurally dissimilar 6PGLs are known to exist: the Escherichia coli (strain K12) YbhE IPR022528 from INTERPRO [] and the Pseudomonas aeruginosa DevB IPR005900 from INTERPRO [] types.  This entry contains bacterial 6-phosphogluconolactonases (6PGL) YbhE-type 3.1.1.31 from EC which hydrolyse 6-phosphogluconolactone to 6-phosphogluconate. The entry also contains the fungal muconate lactonizing enzyme carboxy-cis,cis-muconate cyclase 5.5.1.5 from EC and muconate cycloisomerase 5.5.1.1 from EC, which convert cis,cis-muconates to muconolactones and vice versa as part of the microbial beta-ketoadipate pathway. Structures have been reported for the E. coli 6-phosphogluconolactonase and Neurospora crassa muconate cycloisomerase. Structures of proteins in this family have revealed a 7-bladed beta-propeller fold [].; PDB: 3SCY_A 1L0Q_A 3HFQ_B 3FGB_A 1RI6_A 3U4Y_A 3BWS_A 1JOF_H.
Probab=97.25  E-value=0.0099  Score=72.94  Aligned_cols=153  Identities=12%  Similarity=0.199  Sum_probs=95.9

Q ss_pred             eEEEEEEcCCCCeEEEEe-CCCcEEEeecCCCc--ee--eEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEeCCCc
Q 000080         2221 STRAFSSHPLRPFFLVGS-SNTHIYLWEFGKDK--AT--ATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAALDGT 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS-~DgTIRLWDl~tGk--~l--~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS~DgT 2294 (2389)
                      +...+.|+|||++++... ....|+++++..+.  ..  ..+. ++      +|  ..=+.++|+|||+++ +..-.+++
T Consensus       145 h~H~v~~~pdg~~v~v~dlG~D~v~~~~~~~~~~~l~~~~~~~-~~------~G--~GPRh~~f~pdg~~~Yv~~e~s~~  215 (345)
T PF10282_consen  145 HPHQVVFSPDGRFVYVPDLGADRVYVYDIDDDTGKLTPVDSIK-VP------PG--SGPRHLAFSPDGKYAYVVNELSNT  215 (345)
T ss_dssp             CEEEEEE-TTSSEEEEEETTTTEEEEEEE-TTS-TEEEEEEEE-CS------TT--SSEEEEEE-TTSSEEEEEETTTTE
T ss_pred             cceeEEECCCCCEEEEEecCCCEEEEEEEeCCCceEEEeeccc-cc------cC--CCCcEEEEcCCcCEEEEecCCCCc
Confidence            347889999999766642 33479999997665  32  2232 12      12  446999999999866 66677899


Q ss_pred             EEEeeCCCCCccCcccceeeee----c--CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc--eEEEEeec
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLC----F--SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS--RASITCHE 2366 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~g----H--s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~--v~sL~GH~ 2366 (2389)
                      |.++++....- ..+.+.+...    .  .....+++++| ||++|..+-  -.+++|-++++...+++.  ++.+...-
T Consensus       216 v~v~~~~~~~g-~~~~~~~~~~~~~~~~~~~~~~~i~isp-dg~~lyvsn--r~~~sI~vf~~d~~~g~l~~~~~~~~~G  291 (345)
T PF10282_consen  216 VSVFDYDPSDG-SLTEIQTISTLPEGFTGENAPAEIAISP-DGRFLYVSN--RGSNSISVFDLDPATGTLTLVQTVPTGG  291 (345)
T ss_dssp             EEEEEEETTTT-EEEEEEEEESCETTSCSSSSEEEEEE-T-TSSEEEEEE--CTTTEEEEEEECTTTTTEEEEEEEEESS
T ss_pred             EEEEeecccCC-ceeEEEEeeeccccccccCCceeEEEec-CCCEEEEEe--ccCCEEEEEEEecCCCceEEEEEEeCCC
Confidence            99999982110 1122222211    1  12578899999 999877653  357799999985444443  34444433


Q ss_pred             CcEEEEeecccchhhhcccc
Q 000080         2367 GLYDLFLPLKLLNFALSKCR 2386 (2389)
Q Consensus      2367 ~~V~svA~~~~~~~~~s~~~ 2386 (2389)
                      ..-+.++++|+|+|.+--|+
T Consensus       292 ~~Pr~~~~s~~g~~l~Va~~  311 (345)
T PF10282_consen  292 KFPRHFAFSPDGRYLYVANQ  311 (345)
T ss_dssp             SSEEEEEE-TTSSEEEEEET
T ss_pred             CCccEEEEeCCCCEEEEEec
Confidence            44689999999999886553


No 260
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=97.22  E-value=0.00068  Score=84.45  Aligned_cols=156  Identities=17%  Similarity=0.185  Sum_probs=100.3

Q ss_pred             ccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecC-------CCceeeEecccCCCCCCCCCCCCCEE
Q 000080         2203 TQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG-------KDKATATYGVLPAANVPPPYALASIS 2275 (2389)
Q Consensus      2203 ~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~-------tGk~l~Tl~vl~gh~~p~~GH~~~V~ 2275 (2389)
                      ++.++..|+.+   .+.|  |+++-=.+.+-++|+|.|+|||||.++       +..|.-||+          .|...|.
T Consensus       724 ~~irL~nf~GH---~~~i--Rai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~----------aHkk~i~  788 (1034)
T KOG4190|consen  724 DHIRLCNFTGH---QEKI--RAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQ----------AHKKPIH  788 (1034)
T ss_pred             ceeeeecccCc---HHHh--HHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhh----------hccCccc
Confidence            35566666433   2222  666666677789999999999999876       223566664          3678899


Q ss_pred             EEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC
Q 000080         2276 ALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA 2353 (2389)
Q Consensus      2276 sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~ 2353 (2389)
                      ++-|=.|-+.+||  .||.|.|||.=.|     +++.....  -.+.+..|--.++-.+.|..|| ++...|||+.|...
T Consensus       789 ~igfL~~lr~i~S--cD~giHlWDPFig-----r~Laq~~dapk~~a~~~ikcl~nv~~~iliAg-csaeSTVKl~DaRs  860 (1034)
T KOG4190|consen  789 DIGFLADLRSIAS--CDGGIHLWDPFIG-----RLLAQMEDAPKEGAGGNIKCLENVDRHILIAG-CSAESTVKLFDARS  860 (1034)
T ss_pred             ceeeeeccceeee--ccCcceeeccccc-----chhHhhhcCcccCCCceeEecccCcchheeee-ccchhhheeeeccc
Confidence            9999999888775  5788999998765     22221111  1122333334443134555666 46889999999742


Q ss_pred             CCCCceEEE---EeecCcEEEEeecccchhh
Q 000080         2354 PPTSSRASI---TCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2354 ~tg~~v~sL---~GH~~~V~svA~~~~~~~~ 2381 (2389)
                      -.-.|....   .+-.+-++++|.-++|||.
T Consensus       861 ce~~~E~kVcna~~Pna~~R~iaVa~~GN~l  891 (1034)
T KOG4190|consen  861 CEWTCELKVCNAPGPNALTRAIAVADKGNKL  891 (1034)
T ss_pred             ccceeeEEeccCCCCchheeEEEeccCcchh
Confidence            222222222   3344568899999999993


No 261
>PLN02919 haloacid dehalogenase-like hydrolase family protein
Probab=97.20  E-value=0.0067  Score=84.52  Aligned_cols=149  Identities=10%  Similarity=0.114  Sum_probs=95.2

Q ss_pred             EEEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCC------CCCCCCCCEEEEEECCCCC-EEEEEeCCCc
Q 000080         2223 RAFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANV------PPPYALASISALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus      2223 rsVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~------p~~GH~~~V~sVaFSPDG~-~LASgS~DgT 2294 (2389)
                      +.|+|+| +|.++++.+.++.|++||..+|... ++.+ .+...      +........+.|+|+|||+ .+++-+.+++
T Consensus       686 ~gVa~dp~~g~LyVad~~~~~I~v~d~~~g~v~-~~~G-~G~~~~~~g~~~~~~~~~~P~GIavspdG~~LYVADs~n~~  763 (1057)
T PLN02919        686 WDVCFEPVNEKVYIAMAGQHQIWEYNISDGVTR-VFSG-DGYERNLNGSSGTSTSFAQPSGISLSPDLKELYIADSESSS  763 (1057)
T ss_pred             eEEEEecCCCeEEEEECCCCeEEEEECCCCeEE-EEec-CCccccCCCCccccccccCccEEEEeCCCCEEEEEECCCCe
Confidence            5679999 6778899999999999999877643 3321 01000      0001123457799999998 6667777899


Q ss_pred             EEEeeCCCCCccCcccce-----------eee--------ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2295 VCTWQLEVGGRSNVRPME-----------SCL--------CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~-----------tl~--------gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      |+.||+++++.   ..+.           .+-        ..-..-..++|++ +|.++++-   +.+++|++||.  . 
T Consensus       764 Irv~D~~tg~~---~~~~gg~~~~~~~l~~fG~~dG~g~~~~l~~P~Gvavd~-dG~LYVAD---s~N~rIrviD~--~-  833 (1057)
T PLN02919        764 IRALDLKTGGS---RLLAGGDPTFSDNLFKFGDHDGVGSEVLLQHPLGVLCAK-DGQIYVAD---SYNHKIKKLDP--A-  833 (1057)
T ss_pred             EEEEECCCCcE---EEEEecccccCcccccccCCCCchhhhhccCCceeeEeC-CCcEEEEE---CCCCEEEEEEC--C-
Confidence            99999987531   1000           000        0011235799999 89988764   58899999996  2 


Q ss_pred             CCceEEEEe--------------ecCcEEEEeecccchhhhc
Q 000080         2356 TSSRASITC--------------HEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2356 g~~v~sL~G--------------H~~~V~svA~~~~~~~~~s 2383 (2389)
                      +..+.++.|              +-+....++.+++|+..++
T Consensus       834 tg~v~tiaG~G~~G~~dG~~~~a~l~~P~GIavd~dG~lyVa  875 (1057)
T PLN02919        834 TKRVTTLAGTGKAGFKDGKALKAQLSEPAGLALGENGRLFVA  875 (1057)
T ss_pred             CCeEEEEeccCCcCCCCCcccccccCCceEEEEeCCCCEEEE
Confidence            233444433              2234567888899875544


No 262
>KOG4497 consensus Uncharacterized conserved protein WDR8, contains WD repeats [General function prediction only]
Probab=97.16  E-value=0.0013  Score=79.17  Aligned_cols=134  Identities=14%  Similarity=0.077  Sum_probs=100.4

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCC
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tg 2303 (2389)
                      .+|||+|+++|+.++- .+-+-|..+=+..+.|.-           .+.|.-|-++.|. ..|-.++-|+.|++|++...
T Consensus        14 c~fSp~g~yiAs~~~y-rlviRd~~tlq~~qlf~c-----------ldki~yieW~ads~~ilC~~yk~~~vqvwsl~Qp   81 (447)
T KOG4497|consen   14 CSFSPCGNYIASLSRY-RLVIRDSETLQLHQLFLC-----------LDKIVYIEWKADSCHILCVAYKDPKVQVWSLVQP   81 (447)
T ss_pred             eeECCCCCeeeeeeee-EEEEeccchhhHHHHHHH-----------HHHhhheeeeccceeeeeeeeccceEEEEEeecc
Confidence            3899999999998766 788888876665444421           2556777788887 56667788999999999864


Q ss_pred             CccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080         2304 GRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2304 grs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
                           .-.....+-+..+.++++|| ||+.|...  ++-|-.|.+|.+.   .+...-++.-...+..++++++|+|+
T Consensus        82 -----ew~ckIdeg~agls~~~WSP-dgrhiL~t--seF~lriTVWSL~---t~~~~~~~~pK~~~kg~~f~~dg~f~  148 (447)
T KOG4497|consen   82 -----EWYCKIDEGQAGLSSISWSP-DGRHILLT--SEFDLRITVWSLN---TQKGYLLPHPKTNVKGYAFHPDGQFC  148 (447)
T ss_pred             -----eeEEEeccCCCcceeeeECC-CcceEeee--ecceeEEEEEEec---cceeEEecccccCceeEEECCCCcee
Confidence                 34556677778899999999 88666554  3688899999984   23334455445667899999999985


No 263
>PRK04043 tolB translocation protein TolB; Provisional
Probab=97.13  E-value=0.0057  Score=77.44  Aligned_cols=136  Identities=8%  Similarity=0.058  Sum_probs=82.0

Q ss_pred             EEEEEEcCCCCe-EEEEeC---CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CC--Cc
Q 000080         2222 TRAFSSHPLRPF-FLVGSS---NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LD--GT 2294 (2389)
Q Consensus      2222 VrsVAFsPdG~~-LASGS~---DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~D--gT 2294 (2389)
                      +.+-.|+|||+. ++..+.   +..|+++|+.+|+..+... .          .+.+...+|||||+++|-.. .+  ..
T Consensus       190 ~~~p~wSpDG~~~i~y~s~~~~~~~Iyv~dl~tg~~~~lt~-~----------~g~~~~~~~SPDG~~la~~~~~~g~~~  258 (419)
T PRK04043        190 NIFPKWANKEQTAFYYTSYGERKPTLYKYNLYTGKKEKIAS-S----------QGMLVVSDVSKDGSKLLLTMAPKGQPD  258 (419)
T ss_pred             eEeEEECCCCCcEEEEEEccCCCCEEEEEECCCCcEEEEec-C----------CCcEEeeEECCCCCEEEEEEccCCCcE
Confidence            356799999984 654443   4679999998887644322 1          13356788999998777543 34  45


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCC--eEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGI--NVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~--TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      |.++|+.++.      ...+..+........|+| ||+.|+-..  ..++  .|.+.|+  .+++. +.+... +. ...
T Consensus       259 Iy~~dl~~g~------~~~LT~~~~~d~~p~~SP-DG~~I~F~S--dr~g~~~Iy~~dl--~~g~~-~rlt~~-g~-~~~  324 (419)
T PRK04043        259 IYLYDTNTKT------LTQITNYPGIDVNGNFVE-DDKRIVFVS--DRLGYPNIFMKKL--NSGSV-EQVVFH-GK-NNS  324 (419)
T ss_pred             EEEEECCCCc------EEEcccCCCccCccEECC-CCCEEEEEE--CCCCCceEEEEEC--CCCCe-EeCccC-CC-cCc
Confidence            6666887652      223333333334567999 999888753  2334  4555554  34443 333211 11 224


Q ss_pred             eecccchhhh
Q 000080         2373 LPLKLLNFAL 2382 (2389)
Q Consensus      2373 A~~~~~~~~~ 2382 (2389)
                      +.+|+|++++
T Consensus       325 ~~SPDG~~Ia  334 (419)
T PRK04043        325 SVSTYKNYIV  334 (419)
T ss_pred             eECCCCCEEE
Confidence            7899999764


No 264
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=97.12  E-value=0.002  Score=83.54  Aligned_cols=143  Identities=27%  Similarity=0.489  Sum_probs=95.9

Q ss_pred             ccccccCCCCCC-CcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCC
Q 000080           29 RSEFIPTAPTRS-TSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETP  107 (2389)
Q Consensus        29 ~~~~ip~ap~~~-~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~  107 (2389)
                      -++|+|.+|.++ ++|++|+|.  |  .||||+++.|++..  +  ...+++      |.||.|.-  .|+.|+|.|. |
T Consensus         5 s~~tlpG~l~~sN~~A~Dw~~~--G--LiAygshslV~VVD--s--~s~q~i------qsie~h~s--~V~~VrWap~-~   67 (1062)
T KOG1912|consen    5 SDHTLPGPLSRSNRNAADWSPS--G--LIAYGSHSLVSVVD--S--RSLQLI------QSIELHQS--AVTSVRWAPA-P   67 (1062)
T ss_pred             ccccCCCCCCcccccccccCcc--c--eEEEecCceEEEEe--h--hhhhhh------hccccCcc--ceeEEEeccC-C
Confidence            367888888775 789999997  7  69999999999998  3  344667      99999975  8999999995 4


Q ss_pred             CCC---------cEEEecC--CeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecC---CC-CeEE--EEecceEEe
Q 000080          108 SIG---------QLAAASE--NCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTG---SG-DGIV--AGGMETVLW  170 (2389)
Q Consensus       108 ~~G---------eIaASyD--ntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSp---dG-~rLa--SggdDV~IW  170 (2389)
                      ...         -++|++|  +.|-+|...-+   ....|.+    .+...|-++.|=+   ++ +.|+  .++..+.+|
T Consensus        68 ~p~~llS~~~~~lliAsaD~~GrIil~d~~~~---s~~~~l~----~~~~~~qdl~W~~~rd~Srd~LlaIh~ss~lvLw  140 (1062)
T KOG1912|consen   68 SPRDLLSPSSSQLLIASADISGRIILVDFVLA---SVINWLS----HSNDSVQDLCWVPARDDSRDVLLAIHGSSTLVLW  140 (1062)
T ss_pred             CchhccCccccceeEEeccccCcEEEEEehhh---hhhhhhc----CCCcchhheeeeeccCcchheeEEecCCcEEEEE
Confidence            332         3557776  88888876411   1122332    2455666766643   44 3344  555569999


Q ss_pred             eccCCcEEEEEEeeccccceEEEEeecC
Q 000080          171 KKKNTLWEIAWKFKENYPQNLVSATWSI  198 (2389)
Q Consensus       171 ~~~~s~Wecvwt~~~~~~~~ivsvaWSp  198 (2389)
                      ...+  .+..|+. .+.+..+.|++.-|
T Consensus       141 ntdt--G~k~Wk~-~ys~~iLs~f~~DP  165 (1062)
T KOG1912|consen  141 NTDT--GEKFWKY-DYSHEILSCFRVDP  165 (1062)
T ss_pred             EccC--Cceeecc-ccCCcceeeeeeCC
Confidence            7544  3444542 35566666776666


No 265
>KOG1240 consensus Protein kinase containing WD40 repeats [Signal transduction mechanisms]
Probab=97.05  E-value=0.0094  Score=80.76  Aligned_cols=165  Identities=12%  Similarity=0.083  Sum_probs=110.9

Q ss_pred             ccccccceeeccccccccccccccCCCC-----------cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCC--Ccee-
Q 000080         2189 PGYAGIGASALGWETQDDFEDYVDPPAT-----------VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK--DKAT- 2254 (2389)
Q Consensus      2189 ~g~~~~~Asg~~~d~~~~~~~~~d~~at-----------v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~t--Gk~l- 2254 (2389)
                      ++.+..-++| +.|.+.++|+..+.+..           .++-++..+.+-++|..+|.|+.||.|++-+++.  ++.. 
T Consensus      1058 ~~~~s~Fvsg-S~DGtVKvW~~~k~~~~~~s~rS~ltys~~~sr~~~vt~~~~~~~~Av~t~DG~v~~~~id~~~~~~~~ 1136 (1431)
T KOG1240|consen 1058 SEHTSLFVSG-SDDGTVKVWNLRKLEGEGGSARSELTYSPEGSRVEKVTMCGNGDQFAVSTKDGSVRVLRIDHYNVSKRV 1136 (1431)
T ss_pred             CCCCceEEEe-cCCceEEEeeehhhhcCcceeeeeEEEeccCCceEEEEeccCCCeEEEEcCCCeEEEEEccccccccce
Confidence            3444567888 88888999988644443           1234678899999999999999999999999876  2111 


Q ss_pred             ----eEe-----------cccCCCC-C---------------------------CCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080         2255 ----ATY-----------GVLPAAN-V---------------------------PPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus      2255 ----~Tl-----------~vl~gh~-~---------------------------p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
                          +..           .....|. .                           -++-| +.|++++.+|-|++++.|..
T Consensus      1137 ~~~~ri~n~~~~g~vv~m~a~~~~~~S~~lvy~T~~~~iv~~D~r~~~~~w~lk~~~~h-G~vTSi~idp~~~WlviGts 1215 (1431)
T KOG1240|consen 1137 ATQVRIPNLKKDGVVVSMHAFTAIVQSHVLVYATDLSRIVSWDTRMRHDAWRLKNQLRH-GLVTSIVIDPWCNWLVIGTS 1215 (1431)
T ss_pred             eeeeecccccCCCceEEeecccccccceeEEEEEeccceEEecchhhhhHHhhhcCccc-cceeEEEecCCceEEEEecC
Confidence                000           0000000 0                           04445 78999999999999999999


Q ss_pred             CCcEEEeeCCCCCccCcccceeee-ecCCCeeEEEEecC--CCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCL-CFSSHAMDVSYITS--SGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~-gHs~~V~sVAFSP~--DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      -|.+-+||++=+     .++.++. +|...++-|...|-  ....++++|. +..+-|-+|++.  +|.|.+.|-
T Consensus      1216 ~G~l~lWDLRF~-----~~i~sw~~P~~~~i~~v~~~~~~~~~S~~vs~~~-~~~nevs~wn~~--~g~~~~vl~ 1282 (1431)
T KOG1240|consen 1216 RGQLVLWDLRFR-----VPILSWEHPARAPIRHVWLCPTYPQESVSVSAGS-SSNNEVSTWNME--TGLRQTVLW 1282 (1431)
T ss_pred             CceEEEEEeecC-----ceeecccCcccCCcceEEeeccCCCCceEEEecc-cCCCceeeeecc--cCcceEEEE
Confidence            999999999864     3444432 23345555555542  3367777763 367789999984  556655554


No 266
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=96.90  E-value=0.0094  Score=71.48  Aligned_cols=137  Identities=12%  Similarity=-0.009  Sum_probs=96.5

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCcee--eEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT--ATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l--~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
                      -++.|++.|.-++++-.+|.+.+=+...+...  ++++   +       |.-..+..+|+-.. +.+-+|++|+.+.-||
T Consensus       125 lslD~~~~~~~i~vs~s~G~~~~v~~t~~~le~vq~wk---~-------He~E~Wta~f~~~~pnlvytGgDD~~l~~~D  194 (339)
T KOG0280|consen  125 LSLDISTSGTKIFVSDSRGSISGVYETEMVLEKVQTWK---V-------HEFEAWTAKFSDKEPNLVYTGGDDGSLSCWD  194 (339)
T ss_pred             eEEEeeccCceEEEEcCCCcEEEEecceeeeeeccccc---c-------cceeeeeeecccCCCceEEecCCCceEEEEE
Confidence            46789999999999999999985444334322  2443   3       56778999998554 7999999999999999


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      ++..+.   .....-.-|...|.++-=+|+.+..||||   |-|-+|++||+.. =++.+..-. -.++||-+--+|-
T Consensus       195 ~R~p~~---~i~~n~kvH~~GV~SI~ss~~~~~~I~TG---sYDe~i~~~DtRn-m~kPl~~~~-v~GGVWRi~~~p~  264 (339)
T KOG0280|consen  195 IRIPKT---FIWHNSKVHTSGVVSIYSSPPKPTYIATG---SYDECIRVLDTRN-MGKPLFKAK-VGGGVWRIKHHPE  264 (339)
T ss_pred             ecCCcc---eeeecceeeecceEEEecCCCCCceEEEe---ccccceeeeehhc-ccCccccCc-cccceEEEEecch
Confidence            996421   22233566899999999999899999996   6899999999841 122221110 1166666655553


No 267
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=96.84  E-value=0.0016  Score=78.85  Aligned_cols=134  Identities=11%  Similarity=0.097  Sum_probs=94.5

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCC-----ceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEE
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKD-----KATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVC 2296 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tG-----k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVk 2296 (2389)
                      -++.|+..++++..|-.+|.|-..|++.+     .+.+.+           +|...|++++.=. ++++|.+.+.+|+|+
T Consensus       256 fAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~rl-----------yh~Ssvtslq~Lq~s~q~LmaS~M~gkik  324 (425)
T KOG2695|consen  256 FALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQRL-----------YHDSSVTSLQILQFSQQKLMASDMTGKIK  324 (425)
T ss_pred             HHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEEE-----------EcCcchhhhhhhccccceEeeccCcCcee
Confidence            66789999999999999999999998743     455544           4778999998865 788999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeE--EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE----eecCcEE
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMD--VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT----CHEGLYD 2370 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~s--VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~----GH~~~V~ 2370 (2389)
                      |||++.-.  .-+-+++++||...-.-  +-..+ ....|+++|   +|--.|||.+.  ++..+.++.    .-+..++
T Consensus       325 LyD~R~~K--~~~~V~qYeGHvN~~a~l~~~v~~-eeg~I~s~G---dDcytRiWsl~--~ghLl~tipf~~s~~e~d~~  396 (425)
T KOG2695|consen  325 LYDLRATK--CKKSVMQYEGHVNLSAYLPAHVKE-EEGSIFSVG---DDCYTRIWSLD--SGHLLCTIPFPYSASEVDIP  396 (425)
T ss_pred             Eeeehhhh--cccceeeeeccccccccccccccc-ccceEEEcc---CeeEEEEEecc--cCceeeccCCCCcccccccc
Confidence            99998642  11237888877643221  12223 334566665   99999999983  455555443    2334555


Q ss_pred             EEeec
Q 000080         2371 LFLPL 2375 (2389)
Q Consensus      2371 svA~~ 2375 (2389)
                      ++|+.
T Consensus       397 sv~~~  401 (425)
T KOG2695|consen  397 SVAFD  401 (425)
T ss_pred             ceehh
Confidence            66654


No 268
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=96.74  E-value=0.0022  Score=77.64  Aligned_cols=140  Identities=19%  Similarity=0.279  Sum_probs=92.6

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCC-CceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCc
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGK-DKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGT 2294 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgT 2294 (2389)
                      .+...|.+|+++.|+..++| ++|=.|.||+++- .++..... +..++|--.  +--|++-.|+|.- +.|+=.|.-|+
T Consensus       162 aHtyhiNSIS~NsD~Et~lS-ADdLRINLWnlei~d~sFnIVD-IKP~nmEeL--teVITsaEFhp~~cn~f~YSSSKGt  237 (433)
T KOG1354|consen  162 AHTYHINSISVNSDKETFLS-ADDLRINLWNLEIIDQSFNIVD-IKPANMEEL--TEVITSAEFHPHHCNVFVYSSSKGT  237 (433)
T ss_pred             cceeEeeeeeecCccceEee-ccceeeeeccccccCCceeEEE-ccccCHHHH--HHHHhhhccCHhHccEEEEecCCCc
Confidence            34456789999999999998 5899999999873 33322221 122332100  1347888999985 89999999999


Q ss_pred             EEEeeCCCCCc--cCccccee---------eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2295 VCTWQLEVGGR--SNVRPMES---------CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2295 VkLWDl~tggr--s~~k~l~t---------l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      |||-|++....  ...+.+..         +.+--..|.+|-|++ +|++|+|-    +=-||+|||+.. ..+.+.+.+
T Consensus       238 IrLcDmR~~aLCd~hsKlfEepedp~~rsffseiIsSISDvKFs~-sGryilsR----Dyltvk~wD~nm-e~~pv~t~~  311 (433)
T KOG1354|consen  238 IRLCDMRQSALCDAHSKLFEEPEDPSSRSFFSEIISSISDVKFSH-SGRYILSR----DYLTVKLWDLNM-EAKPVETYP  311 (433)
T ss_pred             EEEeechhhhhhcchhhhhccccCCcchhhHHHHhhhhhceEEcc-CCcEEEEe----ccceeEEEeccc-cCCcceEEe
Confidence            99999985310  00011100         111225688999999 99999983    348999999842 344566666


Q ss_pred             eec
Q 000080         2364 CHE 2366 (2389)
Q Consensus      2364 GH~ 2366 (2389)
                      -|.
T Consensus       312 vh~  314 (433)
T KOG1354|consen  312 VHE  314 (433)
T ss_pred             ehH
Confidence            554


No 269
>KOG0280 consensus Uncharacterized conserved protein [Amino acid transport and metabolism]
Probab=96.72  E-value=0.006  Score=73.04  Aligned_cols=96  Identities=7%  Similarity=0.104  Sum_probs=72.7

Q ss_pred             eeEEEEEEcCCCC-eEEEEeCCCcEEEeecC-CCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEE
Q 000080         2220 ISTRAFSSHPLRP-FFLVGSSNTHIYLWEFG-KDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2220 i~VrsVAFsPdG~-~LASGS~DgTIRLWDl~-tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVk 2296 (2389)
                      .+.|..+|+...+ ++.|||+|+.++.||++ .++.+-+-      .   .-|...|.+|.-| |++..+|+|+-|..|+
T Consensus       166 ~E~Wta~f~~~~pnlvytGgDD~~l~~~D~R~p~~~i~~n------~---kvH~~GV~SI~ss~~~~~~I~TGsYDe~i~  236 (339)
T KOG0280|consen  166 FEAWTAKFSDKEPNLVYTGGDDGSLSCWDIRIPKTFIWHN------S---KVHTSGVVSIYSSPPKPTYIATGSYDECIR  236 (339)
T ss_pred             eeeeeeecccCCCceEEecCCCceEEEEEecCCcceeeec------c---eeeecceEEEecCCCCCceEEEecccccee
Confidence            3558888888766 78899999999999998 44444321      0   1266789999998 5689999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecC
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS 2329 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~ 2329 (2389)
                      +||.+.-+    +|+..-. -.+.|+.+..+|.
T Consensus       237 ~~DtRnm~----kPl~~~~-v~GGVWRi~~~p~  264 (339)
T KOG0280|consen  237 VLDTRNMG----KPLFKAK-VGGGVWRIKHHPE  264 (339)
T ss_pred             eeehhccc----CccccCc-cccceEEEEecch
Confidence            99999654    4554321 3378999998884


No 270
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=96.57  E-value=0.0065  Score=81.54  Aligned_cols=107  Identities=16%  Similarity=0.286  Sum_probs=74.1

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
                      .+.+.++.++.---+-++|.|++-|+|-+.|+. |..-.-.+   +.+     -...|++|+|+.||++++.|=.||.|.
T Consensus        85 ~e~~~~~v~s~a~~~~~ivi~Ts~ghvl~~d~~-~nL~~~~~---ne~-----v~~~Vtsvafn~dg~~l~~G~~~G~V~  155 (1206)
T KOG2079|consen   85 LEDIAAGVISSAIVVVPIVIGTSHGHVLLSDMT-GNLGPLHQ---NER-----VQGPVTSVAFNQDGSLLLAGLGDGHVT  155 (1206)
T ss_pred             ccCCCcceeeeeeeeeeEEEEcCchhhhhhhhh-cccchhhc---CCc-----cCCcceeeEecCCCceeccccCCCcEE
Confidence            334555556666667789999999999999984 43211111   111     126799999999999999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEec--CCCCEEEEe
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYIT--SSGSVIAAA 2337 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP--~DGslLASA 2337 (2389)
                      +||+.++     ++++.+.-|..++..|-++-  .++..+.|+
T Consensus       156 v~D~~~~-----k~l~~i~e~~ap~t~vi~v~~t~~nS~llt~  193 (1206)
T KOG2079|consen  156 VWDMHRA-----KILKVITEHGAPVTGVIFVGRTSQNSKLLTS  193 (1206)
T ss_pred             EEEccCC-----cceeeeeecCCccceEEEEEEeCCCcEEEEc
Confidence            9999986     46666666766666554441  134455553


No 271
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=96.56  E-value=0.0041  Score=73.46  Aligned_cols=73  Identities=16%  Similarity=0.235  Sum_probs=64.8

Q ss_pred             CCEEEEEECCCC-CEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2272 ASISALQFDHYG-HRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2272 ~~V~sVaFSPDG-~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      ..|++++-.|.. +.++.|++||.|-|||.+...    .|...+..|...++.|-|+|.++..|.|+   |+||.+.-||
T Consensus       180 ~~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~----~p~S~l~ahk~~i~eV~FHpk~p~~Lft~---sedGslw~wd  252 (319)
T KOG4714|consen  180 DAVTALCSHPAQQHLVCCGTDDGIVGLWDARNVA----MPVSLLKAHKAEIWEVHFHPKNPEHLFTC---SEDGSLWHWD  252 (319)
T ss_pred             ccchhhhCCcccccEEEEecCCCeEEEEEccccc----chHHHHHHhhhhhhheeccCCCchheeEe---cCCCcEEEEc
Confidence            559999999885 788899999999999999763    57778889999999999999999999986   7999999999


Q ss_pred             C
Q 000080         2351 T 2351 (2389)
Q Consensus      2351 ~ 2351 (2389)
                      .
T Consensus       253 a  253 (319)
T KOG4714|consen  253 A  253 (319)
T ss_pred             C
Confidence            5


No 272
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=96.47  E-value=0.016  Score=73.63  Aligned_cols=168  Identities=15%  Similarity=0.233  Sum_probs=101.0

Q ss_pred             eecCC--CCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEec-CCeEE
Q 000080           45 DWLPD--FAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAAS-ENCIF  121 (2389)
Q Consensus        45 ~wlpD--~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASy-DntIR  121 (2389)
                      .|+-|  ...|--++|..+..+.+-|  +-..+     +|..   ++-... =.-+.|.|||    .|..++++ --.|-
T Consensus       170 ~WL~d~~~RDQf~v~~d~~~~~svfw--N~~~n-----~p~~---ie~Ren-WTetyv~wSP----~GTYL~t~Hk~GI~  234 (698)
T KOG2314|consen  170 SWLMDDKCRDQFVVQDDVKTTVSVFW--NSKFN-----EPSL---IEEREN-WTETYVRWSP----KGTYLVTFHKQGIA  234 (698)
T ss_pred             HHHhCccccceEEEEecCcceeEEEc--cccCC-----chhh---hhhhhc-ceeeeEEecC----CceEEEEEecccee
Confidence            46744  3444346777777677777  42222     1111   111111 2367899999    58889887 46899


Q ss_pred             EEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc-------------eEEeeccCCcEEEEEEe--ecc
Q 000080          122 VFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME-------------TVLWKKKNTLWEIAWKF--KEN  186 (2389)
Q Consensus       122 Vw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD-------------V~IW~~~~s~Wecvwt~--~~~  186 (2389)
                      +|.-.        .|...+-+.|. -|.-|.|||+-+||+|=|-.             +.||+-.++.-+..+..  .+.
T Consensus       235 lWGG~--------~f~r~~RF~Hp-~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e~~~l~IWDI~tG~lkrsF~~~~~~~  305 (698)
T KOG2314|consen  235 LWGGE--------SFDRIQRFYHP-GVQFIDFSPNEKYLVTYSPEPIIVEEDDNEGQQLIIWDIATGLLKRSFPVIKSPY  305 (698)
T ss_pred             eecCc--------cHHHHHhccCC-CceeeecCCccceEEEecCCccccCcccCCCceEEEEEccccchhcceeccCCCc
Confidence            99755        25555555666 68899999999999987652             55777665554444333  233


Q ss_pred             ccceEEEEeecCCCc-eEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEecc
Q 000080          187 YPQNLVSATWSIEGP-SATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRP  252 (2389)
Q Consensus       187 ~~~~ivsvaWSpdG~-fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~P  252 (2389)
                      ..-+++  .||.|++ +|--.++.-             -|. ...+....-...-....|..++|+|
T Consensus       306 ~~WP~f--rWS~DdKy~Arm~~~si-------------sIy-Etpsf~lld~Kslki~gIr~FswsP  356 (698)
T KOG2314|consen  306 LKWPIF--RWSHDDKYFARMTGNSI-------------SIY-ETPSFMLLDKKSLKISGIRDFSWSP  356 (698)
T ss_pred             cccceE--EeccCCceeEEeccceE-------------EEE-ecCceeeecccccCCccccCcccCC
Confidence            334565  9999999 886555321             111 1111111112244667899999999


No 273
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=96.42  E-value=0.0076  Score=46.29  Aligned_cols=30  Identities=30%  Similarity=0.546  Sum_probs=28.1

Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      |...|++++|+|+++.+++++.|++|++||
T Consensus        11 ~~~~i~~~~~~~~~~~~~~~~~d~~~~~~~   40 (40)
T smart00320       11 HTGPVTSVAFSPDGKYLASASDDGTIKLWD   40 (40)
T ss_pred             cCCceeEEEECCCCCEEEEecCCCeEEEcC
Confidence            567899999999999999999999999996


No 274
>PF15492 Nbas_N:  Neuroblastoma-amplified sequence, N terminal
Probab=96.42  E-value=0.046  Score=65.78  Aligned_cols=122  Identities=12%  Similarity=0.175  Sum_probs=80.5

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCC------------------------------------
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVP------------------------------------ 2266 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p------------------------------------ 2266 (2389)
                      |.++||||+.+||.+...|+|+++|+- |..+.+..  |++..+                                    
T Consensus        47 Rkl~WSpD~tlLa~a~S~G~i~vfdl~-g~~lf~I~--p~~~~~~d~~~Aiagl~Fl~~~~s~~ws~ELlvi~Y~G~L~S  123 (282)
T PF15492_consen   47 RKLAWSPDCTLLAYAESTGTIRVFDLM-GSELFVIP--PAMSFPGDLSDAIAGLIFLEYKKSAQWSYELLVINYRGQLRS  123 (282)
T ss_pred             eEEEECCCCcEEEEEcCCCeEEEEecc-cceeEEcC--cccccCCccccceeeeEeeccccccccceeEEEEeccceeee
Confidence            888999999999999999999999984 43332221  111000                                    


Q ss_pred             -------------------CCCCCCCEEEEEECCCCCEEEEEeCC-----------CcEEEeeCCCCC----------c-
Q 000080         2267 -------------------PPYALASISALQFDHYGHRFASAALD-----------GTVCTWQLEVGG----------R- 2305 (2389)
Q Consensus      2267 -------------------~~GH~~~V~sVaFSPDG~~LASgS~D-----------gTVkLWDl~tgg----------r- 2305 (2389)
                                         ..++...|.++.+.|.-+.|..|+..           .-+.-|.+-.+.          . 
T Consensus       124 y~vs~gt~q~y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~a~~~GLtaWRiL~~~Pyyk~v~~~~~~  203 (282)
T PF15492_consen  124 YLVSVGTNQGYQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSKASSCGLTAWRILSDSPYYKQVTSSEDD  203 (282)
T ss_pred             EEEEcccCCcceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCccccccccCceEEEEcCCCCcEEEccccCcc
Confidence                               12234569999999998888777642           135567553320          0 


Q ss_pred             -------cCccccee-----e-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2306 -------SNVRPMES-----C-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2306 -------s~~k~l~t-----l-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                             .+...+.+     . ......|..+..|| ||++||+.   ..+|.|.||++
T Consensus       204 ~~~~~~~~~~~~~~~~~~fs~~~~~~d~i~kmSlSP-dg~~La~i---h~sG~lsLW~i  258 (282)
T PF15492_consen  204 ITASSKRRGLLRIPSFKFFSRQGQEQDGIFKMSLSP-DGSLLACI---HFSGSLSLWEI  258 (282)
T ss_pred             ccccccccceeeccceeeeeccccCCCceEEEEECC-CCCEEEEE---EcCCeEEEEec
Confidence                   00000111     1 12357889999999 99999997   47899999998


No 275
>KOG0309 consensus Conserved WD40 repeat-containing protein [Function unknown]
Probab=96.39  E-value=0.0071  Score=78.27  Aligned_cols=133  Identities=21%  Similarity=0.343  Sum_probs=99.2

Q ss_pred             EEEEEcCC--CC-eEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEE
Q 000080         2223 RAFSSHPL--RP-FFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVC 2296 (2389)
Q Consensus      2223 rsVAFsPd--G~-~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVk 2296 (2389)
                      -.+.|+|.  -+ ++++-|. ..--+|++....  .+.-+  +       .||+..|+.+-|+|+- ..+|+++.|-.|.
T Consensus        71 ad~qws~h~a~~~wiVsts~-qkaiiwnlA~ss~~aIef~--l-------hghsraitd~n~~~q~pdVlatcsvdt~vh  140 (1081)
T KOG0309|consen   71 ADVQWSPHPAKPYWIVSTSN-QKAIIWNLAKSSSNAIEFV--L-------HGHSRAITDINFNPQHPDVLATCSVDTYVH  140 (1081)
T ss_pred             cceecccCCCCceeEEecCc-chhhhhhhhcCCccceEEE--E-------ecCccceeccccCCCCCcceeeccccccce
Confidence            33455554  33 4665544 445589987443  34322  2       3688999999999986 7999999999999


Q ss_pred             EeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEee
Q 000080         2297 TWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2297 LWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~ 2374 (2389)
                      .||+++..    .|+....--......|+++-.++..||+    +.++.|++||+. ..+..+.++.+|...|+.+++
T Consensus       141 ~wd~rSp~----~p~ys~~~w~s~asqVkwnyk~p~vlas----shg~~i~vwd~r-~gs~pl~s~K~~vs~vn~~~f  209 (1081)
T KOG0309|consen  141 AWDMRSPH----RPFYSTSSWRSAASQVKWNYKDPNVLAS----SHGNDIFVWDLR-KGSTPLCSLKGHVSSVNSIDF  209 (1081)
T ss_pred             eeeccCCC----cceeeeecccccCceeeecccCcchhhh----ccCCceEEEecc-CCCcceEEecccceeeehHHH
Confidence            99999863    6777766555667889999879999997    588999999984 233458999999988887765


No 276
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=96.19  E-value=0.17  Score=62.50  Aligned_cols=151  Identities=9%  Similarity=0.067  Sum_probs=99.8

Q ss_pred             EEEEEcCCCCeEEEEe-CCCcEEEeecCC-CceeeEecccCCCCCCCCCC----CCCEEEEEECCCCCEEEEEeCC-CcE
Q 000080         2223 RAFSSHPLRPFFLVGS-SNTHIYLWEFGK-DKATATYGVLPAANVPPPYA----LASISALQFDHYGHRFASAALD-GTV 2295 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS-~DgTIRLWDl~t-Gk~l~Tl~vl~gh~~p~~GH----~~~V~sVaFSPDG~~LASgS~D-gTV 2295 (2389)
                      -.|+++++|++|++++ .-|.|.+.-++. |......+. ..|.-+ ..|    ..-+....|+|||+++++.+.. ..|
T Consensus        92 ~yvsvd~~g~~vf~AnY~~g~v~v~p~~~dG~l~~~v~~-~~h~g~-~p~~rQ~~~h~H~a~~tP~~~~l~v~DLG~Dri  169 (346)
T COG2706          92 CYVSVDEDGRFVFVANYHSGSVSVYPLQADGSLQPVVQV-VKHTGS-GPHERQESPHVHSANFTPDGRYLVVPDLGTDRI  169 (346)
T ss_pred             eEEEECCCCCEEEEEEccCceEEEEEcccCCccccceee-eecCCC-CCCccccCCccceeeeCCCCCEEEEeecCCceE
Confidence            4569999999999988 568899999865 543322111 122211 112    0128999999999999998853 458


Q ss_pred             EEeeCCCCCccCcccceee-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEee---------
Q 000080         2296 CTWQLEVGGRSNVRPMESC-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCH--------- 2365 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH--------- 2365 (2389)
                      .+++++.|.   +.+.... ..-...-+-++|+| +|++.-..  +--++||-+|++... ...+..+|-|         
T Consensus       170 ~~y~~~dg~---L~~~~~~~v~~G~GPRHi~FHp-n~k~aY~v--~EL~stV~v~~y~~~-~g~~~~lQ~i~tlP~dF~g  242 (346)
T COG2706         170 FLYDLDDGK---LTPADPAEVKPGAGPRHIVFHP-NGKYAYLV--NELNSTVDVLEYNPA-VGKFEELQTIDTLPEDFTG  242 (346)
T ss_pred             EEEEcccCc---cccccccccCCCCCcceEEEcC-CCcEEEEE--eccCCEEEEEEEcCC-CceEEEeeeeccCccccCC
Confidence            999999763   2232221 12334557799999 99976664  268999999998532 2334444443         


Q ss_pred             cCcEEEEeecccchhhh
Q 000080         2366 EGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2366 ~~~V~svA~~~~~~~~~ 2382 (2389)
                      ..+...|..+++|||.-
T Consensus       243 ~~~~aaIhis~dGrFLY  259 (346)
T COG2706         243 TNWAAAIHISPDGRFLY  259 (346)
T ss_pred             CCceeEEEECCCCCEEE
Confidence            35677899999999853


No 277
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=96.15  E-value=0.014  Score=71.04  Aligned_cols=74  Identities=20%  Similarity=0.461  Sum_probs=62.7

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .+++++|.|..++|.||+.|..|-+||++-.+-+ .+.        +.||.+.|+++..-+--++|.|++.||-|-+||.
T Consensus       199 ~~~~l~Wd~~~~~LfSg~~d~~vi~wdigg~~g~-~~e--------l~gh~~kV~~l~~~~~t~~l~S~~edg~i~~w~m  269 (404)
T KOG1409|consen  199 EVTCLKWDPGQRLLFSGASDHSVIMWDIGGRKGT-AYE--------LQGHNDKVQALSYAQHTRQLISCGEDGGIVVWNM  269 (404)
T ss_pred             ceEEEEEcCCCcEEEeccccCceEEEeccCCcce-eee--------eccchhhhhhhhhhhhheeeeeccCCCeEEEEec
Confidence            5689999999999999999999999999744433 222        1367799999999999999999999999999998


Q ss_pred             CCC
Q 000080         2301 EVG 2303 (2389)
Q Consensus      2301 ~tg 2303 (2389)
                      +..
T Consensus       270 n~~  272 (404)
T KOG1409|consen  270 NVK  272 (404)
T ss_pred             cce
Confidence            764


No 278
>PF11768 DUF3312:  Protein of unknown function (DUF3312);  InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=96.01  E-value=0.021  Score=73.62  Aligned_cols=69  Identities=9%  Similarity=0.128  Sum_probs=58.2

Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ..|.+.++||+.++|+.|..||+|.|||..++       +.++..+.-....++|+| +|.+++.|   ++-|.+++||+
T Consensus       260 s~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~-------~t~~~ka~~~P~~iaWHp-~gai~~V~---s~qGelQ~FD~  328 (545)
T PF11768_consen  260 SQVICCARSPSEDKLVLGCEDGSIILYDTTRG-------VTLLAKAEFIPTLIAWHP-DGAIFVVG---SEQGELQCFDM  328 (545)
T ss_pred             CcceEEecCcccceEEEEecCCeEEEEEcCCC-------eeeeeeecccceEEEEcC-CCcEEEEE---cCCceEEEEEe
Confidence            66999999999999999999999999999864       223334455667899999 99999986   57799999998


No 279
>PF04762 IKI3:  IKI3 family;  InterPro: IPR006849 Members of this family are components of the elongator multi-subunit component of a novel RNA polymerase II holoenzyme for transcriptional elongation [].
Probab=95.96  E-value=0.46  Score=66.16  Aligned_cols=164  Identities=23%  Similarity=0.413  Sum_probs=99.2

Q ss_pred             eeEEEEcCCCCCCCcEEEec-----CCeEEEEeeCCCCCCCCccceeeEEe---cccceEEEEeecCCCCeEEEEec-ce
Q 000080           97 VTSISWSPETPSIGQLAAAS-----ENCIFVFAHDSASSKGSFCWSQNAIL---VQGTKVEAIEWTGSGDGIVAGGM-ET  167 (2389)
Q Consensus        97 Vk~VaWSPd~~~~GeIaASy-----DntIRVw~~d~~~~kgd~~W~~~~tL---~hssTV~sIAWSpdG~rLaSggd-DV  167 (2389)
                      =-+++|.|    +|.++|+.     ...|.+|++..-. -|+|      +|   .....|..|+||+||+-||..-. .|
T Consensus       259 e~~l~WrP----sG~lIA~~q~~~~~~~VvFfErNGLr-hgeF------~l~~~~~~~~v~~l~Wn~ds~iLAv~~~~~v  327 (928)
T PF04762_consen  259 EGALSWRP----SGNLIASSQRLPDRHDVVFFERNGLR-HGEF------TLRFDPEEEKVIELAWNSDSEILAVWLEDRV  327 (928)
T ss_pred             cCCccCCC----CCCEEEEEEEcCCCcEEEEEecCCcE-eeeE------ecCCCCCCceeeEEEECCCCCEEEEEecCCc
Confidence            34789999    57777653     2567777776211 1111      12   24668999999999999995544 59


Q ss_pred             EEeeccCCcEEEEEEeeccccceEEEEeecCCCc----eEeeec-ccc----cccC---C-CCCCCceeEEEeeCCCccc
Q 000080          168 VLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP----SATAAS-MSQ----LDLL---G-PKEAGKCVFICCSDGKSEY  234 (2389)
Q Consensus       168 ~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~----fATag~-dik----f~~~---~-~~~~~kpV~V~~~dg~~~~  234 (2389)
                      ++|-.+|.-|=.=-.+.-.....+..+.|+|.-.    +.|.++ ...    +...   + ..++...|.|.  ||..-.
T Consensus       328 qLWt~~NYHWYLKqei~~~~~~~~~~~~Wdpe~p~~L~v~t~~g~~~~~~~~~~v~~s~~~~~~D~g~vaVI--DG~~ll  405 (928)
T PF04762_consen  328 QLWTRSNYHWYLKQEIRFSSSESVNFVKWDPEKPLRLHVLTSNGQYEIYDFAWDVSRSPGSSPNDNGTVAVI--DGNKLL  405 (928)
T ss_pred             eEEEeeCCEEEEEEEEEccCCCCCCceEECCCCCCEEEEEecCCcEEEEEEEEEEEecCCCCccCceEEEEE--eCCeEE
Confidence            9999999998432222211222233379999744    445423 211    1111   1 12223445555  444311


Q ss_pred             e-------------eecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEEEEEeec
Q 000080          235 I-------------KLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVRLWCEMD  286 (2389)
Q Consensus       235 ~-------------~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVRLW~e~d  286 (2389)
                      .             ..+..-+.+|+.|+++|+        +..     +|.-..||++-+|+...
T Consensus       406 lTpf~~a~VPPPMs~~~l~~~~~v~~vaf~~~--------~~~-----~avl~~d~~l~~~~~~~  457 (928)
T PF04762_consen  406 LTPFRRAVVPPPMSSYELELPSPVNDVAFSPS--------NSR-----FAVLTSDGSLSIYEWDL  457 (928)
T ss_pred             EecccccCCCchHhceEEcCCCCcEEEEEeCC--------CCe-----EEEEECCCCEEEEEecC
Confidence            1             123566789999999993        222     88888999999999654


No 280
>COG2706 3-carboxymuconate cyclase [Carbohydrate transport and metabolism]
Probab=95.91  E-value=0.18  Score=62.33  Aligned_cols=128  Identities=15%  Similarity=0.194  Sum_probs=84.1

Q ss_pred             eEEEEEEcCCCCeEEE-EeCCCcEEEeecCCC--c--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe-CCCc
Q 000080         2221 STRAFSSHPLRPFFLV-GSSNTHIYLWEFGKD--K--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-LDGT 2294 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LAS-GS~DgTIRLWDl~tG--k--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-~DgT 2294 (2389)
                      .-|-|+|||+|++... .=-+++|-+|+....  +  ++++...+|+.-   .| ..+..+|..+|||++|-+.- ....
T Consensus       192 GPRHi~FHpn~k~aY~v~EL~stV~v~~y~~~~g~~~~lQ~i~tlP~dF---~g-~~~~aaIhis~dGrFLYasNRg~ds  267 (346)
T COG2706         192 GPRHIVFHPNGKYAYLVNELNSTVDVLEYNPAVGKFEELQTIDTLPEDF---TG-TNWAAAIHISPDGRFLYASNRGHDS  267 (346)
T ss_pred             CcceEEEcCCCcEEEEEeccCCEEEEEEEcCCCceEEEeeeeccCcccc---CC-CCceeEEEECCCCCEEEEecCCCCe
Confidence            4488899999997443 458999999999863  2  344443344431   23 26789999999999876544 4456


Q ss_pred             EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCC
Q 000080         2295 VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPT 2356 (2389)
Q Consensus      2295 VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg 2356 (2389)
                      |-+.-+...+. .+..+....-|...-+++.|+| +|++|+.++-  ++.+|.++.....+|
T Consensus       268 I~~f~V~~~~g-~L~~~~~~~teg~~PR~F~i~~-~g~~Liaa~q--~sd~i~vf~~d~~TG  325 (346)
T COG2706         268 IAVFSVDPDGG-KLELVGITPTEGQFPRDFNINP-SGRFLIAANQ--KSDNITVFERDKETG  325 (346)
T ss_pred             EEEEEEcCCCC-EEEEEEEeccCCcCCccceeCC-CCCEEEEEcc--CCCcEEEEEEcCCCc
Confidence            66666654320 1222222233444468999999 9999998863  556799999854443


No 281
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=95.89  E-value=0.011  Score=70.99  Aligned_cols=140  Identities=15%  Similarity=0.198  Sum_probs=93.1

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCc
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGT 2294 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgT 2294 (2389)
                      .+...+.+|+|+.|.+.++| ++|=.|.||++.-.. +..... +..|+|.-.  .--|++-.|+|.- +.|.=.+..|+
T Consensus       170 aH~yhiNSiS~NsD~et~lS-aDdLrINLWnl~i~D~sFnIVD-iKP~nmeeL--teVItSaeFhp~~cn~fmYSsSkG~  245 (460)
T COG5170         170 AHPYHINSISFNSDKETLLS-ADDLRINLWNLEIIDGSFNIVD-IKPHNMEEL--TEVITSAEFHPEMCNVFMYSSSKGE  245 (460)
T ss_pred             cceeEeeeeeecCchheeee-ccceeeeeccccccCCceEEEe-ccCccHHHH--HHHHhhcccCHhHcceEEEecCCCc
Confidence            34456789999999999998 589999999987433 222111 233443210  1347888999985 67777888999


Q ss_pred             EEEeeCCCCCc-cCcccce--e--------eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2295 VCTWQLEVGGR-SNVRPME--S--------CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2295 VkLWDl~tggr-s~~k~l~--t--------l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      |+|-|++.... -+.+.+.  +        +.+-...|.++.|++ +|++|++-    +=-||+|||+.. ...++.++.
T Consensus       246 Ikl~DlRq~alcdn~~klfe~~~D~v~~~ff~eivsSISD~kFs~-ngryIlsR----dyltvkiwDvnm-~k~pikTi~  319 (460)
T COG5170         246 IKLNDLRQSALCDNSKKLFELTIDGVDVDFFEEIVSSISDFKFSD-NGRYILSR----DYLTVKIWDVNM-AKNPIKTIP  319 (460)
T ss_pred             EEehhhhhhhhccCchhhhhhccCcccchhHHHHhhhhcceEEcC-CCcEEEEe----ccceEEEEeccc-ccCCceeec
Confidence            99999985310 0001111  1        112235678999999 99999984    557999999853 346677765


Q ss_pred             eec
Q 000080         2364 CHE 2366 (2389)
Q Consensus      2364 GH~ 2366 (2389)
                      -|.
T Consensus       320 ~h~  322 (460)
T COG5170         320 MHC  322 (460)
T ss_pred             hHH
Confidence            454


No 282
>KOG1354 consensus Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=95.87  E-value=0.021  Score=69.64  Aligned_cols=136  Identities=18%  Similarity=0.248  Sum_probs=90.9

Q ss_pred             EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCc-ee---eEecccCCCCCC---CCCCCCCEEEEEECCCCCEEEEEeCCC
Q 000080         2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDK-AT---ATYGVLPAANVP---PPYALASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk-~l---~Tl~vl~gh~~p---~~GH~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
                      |.+.-|||..- .++-.|.-|+|||-|+++.. |-   +.|. .|-....   ..+-...|..|+||+.|++++|-+. -
T Consensus       216 ITsaEFhp~~cn~f~YSSSKGtIrLcDmR~~aLCd~hsKlfE-epedp~~rsffseiIsSISDvKFs~sGryilsRDy-l  293 (433)
T KOG1354|consen  216 ITSAEFHPHHCNVFVYSSSKGTIRLCDMRQSALCDAHSKLFE-EPEDPSSRSFFSEIISSISDVKFSHSGRYILSRDY-L  293 (433)
T ss_pred             HhhhccCHhHccEEEEecCCCcEEEeechhhhhhcchhhhhc-cccCCcchhhHHHHhhhhhceEEccCCcEEEEecc-c
Confidence            46778999754 67778999999999997443 11   1221 1111000   1112356899999999999998765 8


Q ss_pred             cEEEeeCCCCCccCcccceeeeecCC------------Cee---EEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc
Q 000080         2294 TVCTWQLEVGGRSNVRPMESCLCFSS------------HAM---DVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS 2358 (2389)
Q Consensus      2294 TVkLWDl~tggrs~~k~l~tl~gHs~------------~V~---sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~ 2358 (2389)
                      ||+|||++...    +|+.+.+-|..            .|.   .++|+. ++..++||   |-.+..|+.+.. ...+.
T Consensus       294 tvk~wD~nme~----~pv~t~~vh~~lr~kLc~lYEnD~IfdKFec~~sg-~~~~v~TG---sy~n~frvf~~~-~gsk~  364 (433)
T KOG1354|consen  294 TVKLWDLNMEA----KPVETYPVHEYLRSKLCSLYENDAIFDKFECSWSG-NDSYVMTG---SYNNVFRVFNLA-RGSKE  364 (433)
T ss_pred             eeEEEeccccC----CcceEEeehHhHHHHHHHHhhccchhheeEEEEcC-CcceEecc---cccceEEEecCC-CCcce
Confidence            99999998653    67777777652            333   588998 88999996   467899999952 22222


Q ss_pred             eEEEEeecCc
Q 000080         2359 RASITCHEGL 2368 (2389)
Q Consensus      2359 v~sL~GH~~~ 2368 (2389)
                      -.++.+....
T Consensus       365 d~tl~asr~~  374 (433)
T KOG1354|consen  365 DFTLEASRKN  374 (433)
T ss_pred             eecccccccC
Confidence            3455544433


No 283
>KOG4190 consensus Uncharacterized conserved protein [Function unknown]
Probab=95.87  E-value=0.0057  Score=76.71  Aligned_cols=79  Identities=19%  Similarity=0.247  Sum_probs=64.9

Q ss_pred             CCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCcc--CcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080         2268 PYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRS--NVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs--~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
                      .||...|++++-=.+-+-|.|+|.|.|||||.++..+..  ...+-.+++.|...|.++.|-- |-+.+|+     -|+-
T Consensus       732 ~GH~~~iRai~AidNENSFiSASkDKTVKLWSik~EgD~~~tsaCQfTY~aHkk~i~~igfL~-~lr~i~S-----cD~g  805 (1034)
T KOG4190|consen  732 TGHQEKIRAIAAIDNENSFISASKDKTVKLWSIKPEGDEIGTSACQFTYQAHKKPIHDIGFLA-DLRSIAS-----CDGG  805 (1034)
T ss_pred             cCcHHHhHHHHhcccccceeeccCCceEEEEEeccccCccccceeeeEhhhccCcccceeeee-ccceeee-----ccCc
Confidence            367889999987777889999999999999999775321  1136678899999999999998 7788886     4788


Q ss_pred             EEEeeCC
Q 000080         2346 VVVWDTL 2352 (2389)
Q Consensus      2346 VrLWD~l 2352 (2389)
                      |.+||..
T Consensus       806 iHlWDPF  812 (1034)
T KOG4190|consen  806 IHLWDPF  812 (1034)
T ss_pred             ceeeccc
Confidence            9999974


No 284
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.56  E-value=0.18  Score=60.54  Aligned_cols=128  Identities=11%  Similarity=0.033  Sum_probs=86.3

Q ss_pred             EEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccce-
Q 000080         2234 FLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPME- 2312 (2389)
Q Consensus      2234 LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~- 2312 (2389)
                      +.-+|.|.|+|+.++.-+......     |. +    .-.+.+.++||||+++++.++-..|-++-+...+.   .... 
T Consensus       131 ~~i~sndht~k~~~~~~~s~~~~~-----h~-~----~~~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~se---y~~~~  197 (344)
T KOG4532|consen  131 LNIASNDHTGKTMVVSGDSNKFAV-----HN-Q----NLTQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESE---YIENI  197 (344)
T ss_pred             eeeccCCcceeEEEEecCccccee-----ec-c----ccceeeeEEcCCCceEEEecCCCcceEEEeCCccc---eeeee
Confidence            444689999999999655432221     21 0    02288999999999999999999999998876431   2222 


Q ss_pred             eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC---CCCCceEEEEeecCcEEEEeecccc
Q 000080         2313 SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA---PPTSSRASITCHEGLYDLFLPLKLL 2378 (2389)
Q Consensus      2313 tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~---~tg~~v~sL~GH~~~V~svA~~~~~ 2378 (2389)
                      ....-+.+-....|+. .....|++   +.|+++.|||+..   +....-.+=..|.+.++.+-+++.|
T Consensus       198 ~~a~t~D~gF~~S~s~-~~~~FAv~---~Qdg~~~I~DVR~~~tpm~~~sstrp~hnGa~R~c~Fsl~g  262 (344)
T KOG4532|consen  198 YEAPTSDHGFYNSFSE-NDLQFAVV---FQDGTCAIYDVRNMATPMAEISSTRPHHNGAFRVCRFSLYG  262 (344)
T ss_pred             EecccCCCceeeeecc-CcceEEEE---ecCCcEEEEEecccccchhhhcccCCCCCCceEEEEecCCC
Confidence            2333445566788998 56788886   6999999999841   1111111223488888888888654


No 285
>KOG2321 consensus WD40 repeat protein [General function prediction only]
Probab=95.53  E-value=0.09  Score=67.55  Aligned_cols=116  Identities=13%  Similarity=0.203  Sum_probs=83.4

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      |.+++|--.--|..|+....|+=.++.+|+-+..|..          ..+.|++|..+|--..||.|+.||+|..||.++
T Consensus       137 RDm~y~~~scDly~~gsg~evYRlNLEqGrfL~P~~~----------~~~~lN~v~in~~hgLla~Gt~~g~VEfwDpR~  206 (703)
T KOG2321|consen  137 RDMKYHKPSCDLYLVGSGSEVYRLNLEQGRFLNPFET----------DSGELNVVSINEEHGLLACGTEDGVVEFWDPRD  206 (703)
T ss_pred             ccccccCCCccEEEeecCcceEEEEcccccccccccc----------ccccceeeeecCccceEEecccCceEEEecchh
Confidence            4445554333344555566799999999998877752          136799999999999999999999999999987


Q ss_pred             CCcc-CcccceeeeecCCC-----eeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2303 GGRS-NVRPMESCLCFSSH-----AMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2303 ggrs-~~k~l~tl~gHs~~-----V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      ..+. .+....+...|.+.     |+++.|+- ||-.+|.|   +.+|.|-|+|+.
T Consensus       207 ksrv~~l~~~~~v~s~pg~~~~~svTal~F~d-~gL~~aVG---ts~G~v~iyDLR  258 (703)
T KOG2321|consen  207 KSRVGTLDAASSVNSHPGGDAAPSVTALKFRD-DGLHVAVG---TSTGSVLIYDLR  258 (703)
T ss_pred             hhhheeeecccccCCCccccccCcceEEEecC-CceeEEee---ccCCcEEEEEcc
Confidence            4210 01111222234444     99999997 89999874   678999999984


No 286
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=95.47  E-value=0.24  Score=62.69  Aligned_cols=139  Identities=12%  Similarity=0.043  Sum_probs=95.5

Q ss_pred             eEEEEEEcCCCCeEEEEeCCC-cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNT-HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~Dg-TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +||-..+.-++.-++-|-.|| .+-++|.++|+..+.-.           ..+.|.+|+.+|||+.++.|-.-..+-+-|
T Consensus       361 ~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e~kr~e~-----------~lg~I~av~vs~dGK~~vvaNdr~el~vid  429 (668)
T COG4946         361 GVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGEVKRIEK-----------DLGNIEAVKVSPDGKKVVVANDRFELWVID  429 (668)
T ss_pred             ceEEEEEccCCcceEEeccCCceEEEEecCCceEEEeeC-----------CccceEEEEEcCCCcEEEEEcCceEEEEEE
Confidence            356677777777788899999 99999998877544321           236799999999999999988888777779


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC--CCCeEEEeeCCCCCCCceEEEEeecCcEEEEeeccc
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS--NGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS--~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      +.+|   +++.+..  ...+-|.+++++| ++++||=| +-+  --+.|+|+|+.  +++. .....-++-=.+=|+.|+
T Consensus       430 idng---nv~~idk--S~~~lItdf~~~~-nsr~iAYa-fP~gy~tq~Iklydm~--~~Ki-y~vTT~ta~DfsPaFD~d  499 (668)
T COG4946         430 IDNG---NVRLIDK--SEYGLITDFDWHP-NSRWIAYA-FPEGYYTQSIKLYDMD--GGKI-YDVTTPTAYDFSPAFDPD  499 (668)
T ss_pred             ecCC---CeeEecc--cccceeEEEEEcC-CceeEEEe-cCcceeeeeEEEEecC--CCeE-EEecCCcccccCcccCCC
Confidence            9987   2233322  2457889999999 89999964 311  23579999983  3332 222212221234566666


Q ss_pred             chh
Q 000080         2378 LNF 2380 (2389)
Q Consensus      2378 ~~~ 2380 (2389)
                      ||.
T Consensus       500 ~ry  502 (668)
T COG4946         500 GRY  502 (668)
T ss_pred             CcE
Confidence            664


No 287
>PF11768 DUF3312:  Protein of unknown function (DUF3312);  InterPro: IPR024511 This is a eukaryotic family of uncharacterised proteins that contain WD40 repeats.
Probab=95.30  E-value=0.049  Score=70.39  Aligned_cols=71  Identities=11%  Similarity=0.217  Sum_probs=58.9

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|.+.+++|+...|+.|..||+|.|||..++....+ +   +.        =..+.|+++|+|..|++|+.-|.+++||+
T Consensus       261 ~v~~ca~sp~E~kLvlGC~DgSiiLyD~~~~~t~~~-k---a~--------~~P~~iaWHp~gai~~V~s~qGelQ~FD~  328 (545)
T PF11768_consen  261 QVICCARSPSEDKLVLGCEDGSIILYDTTRGVTLLA-K---AE--------FIPTLIAWHPDGAIFVVGSEQGELQCFDM  328 (545)
T ss_pred             cceEEecCcccceEEEEecCCeEEEEEcCCCeeeee-e---ec--------ccceEEEEcCCCcEEEEEcCCceEEEEEe
Confidence            458899999999999999999999999877743322 1   11        22588999999999999999999999999


Q ss_pred             CCC
Q 000080         2301 EVG 2303 (2389)
Q Consensus      2301 ~tg 2303 (2389)
                      .-.
T Consensus       329 ALs  331 (545)
T PF11768_consen  329 ALS  331 (545)
T ss_pred             ecC
Confidence            764


No 288
>KOG1334 consensus WD40 repeat protein [General function prediction only]
Probab=95.26  E-value=0.026  Score=71.17  Aligned_cols=106  Identities=18%  Similarity=0.193  Sum_probs=83.2

Q ss_pred             CCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCC-CEEEEeecCCCCCeEE
Q 000080         2269 YALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSG-SVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2269 GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DG-slLASAG~sS~D~TVr 2347 (2389)
                      +|.+-|..|.|+..|..|+|||.|.+|-+||-..+.    ..+.--.||...|...-|.|..| +.|++.   +.||.||
T Consensus       140 ~H~GcVntV~FN~~Gd~l~SgSDD~~vv~WdW~~~~----~~l~f~SGH~~NvfQaKFiP~s~d~ti~~~---s~dgqvr  212 (559)
T KOG1334|consen  140 KHKGCVNTVHFNQRGDVLASGSDDLQVVVWDWVSGS----PKLSFESGHCNNVFQAKFIPFSGDRTIVTS---SRDGQVR  212 (559)
T ss_pred             CCCCccceeeecccCceeeccCccceEEeehhhccC----cccccccccccchhhhhccCCCCCcCceec---cccCcee
Confidence            567899999999999999999999999999998762    22333467888787778988733 567764   6999999


Q ss_pred             EeeCCCCCCCc--eEEEEeecCcEEEEeecccchhhh
Q 000080         2348 VWDTLAPPTSS--RASITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2348 LWD~l~~tg~~--v~sL~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      +=.++ .++.+  ...+.-|.+.|.-+|.-|.-..-+
T Consensus       213 ~s~i~-~t~~~e~t~rl~~h~g~vhklav~p~sp~~f  248 (559)
T KOG1334|consen  213 VSEIL-ETGYVENTKRLAPHEGPVHKLAVEPDSPKPF  248 (559)
T ss_pred             eeeec-cccceecceecccccCccceeeecCCCCCcc
Confidence            99985 45555  466788999999999887755443


No 289
>PF08450 SGL:  SMP-30/Gluconolaconase/LRE-like region;  InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=95.22  E-value=0.66  Score=54.10  Aligned_cols=141  Identities=15%  Similarity=0.116  Sum_probs=92.1

Q ss_pred             eeEEEEEEcCCCCeEEEEeCC--------CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEE-EEEe
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSN--------THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRF-ASAA 2290 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~D--------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L-ASgS 2290 (2389)
                      .....+++.|+|.+.++.+..        +.|..++.. ++.......           ...-..|+|+|||+.| ++-+
T Consensus        86 ~~~ND~~vd~~G~ly~t~~~~~~~~~~~~g~v~~~~~~-~~~~~~~~~-----------~~~pNGi~~s~dg~~lyv~ds  153 (246)
T PF08450_consen   86 NRPNDVAVDPDGNLYVTDSGGGGASGIDPGSVYRIDPD-GKVTVVADG-----------LGFPNGIAFSPDGKTLYVADS  153 (246)
T ss_dssp             EEEEEEEE-TTS-EEEEEECCBCTTCGGSEEEEEEETT-SEEEEEEEE-----------ESSEEEEEEETTSSEEEEEET
T ss_pred             CCCceEEEcCCCCEEEEecCCCccccccccceEEECCC-CeEEEEecC-----------cccccceEECCcchheeeccc
Confidence            455788999999999987755        567888876 664443321           2446899999999866 5777


Q ss_pred             CCCcEEEeeCCCCCc--cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080         2291 LDGTVCTWQLEVGGR--SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggr--s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
                      ..+.|.-+++...+.  ...+.+..+..-.+....+++.. +|++.++.   ...+.|.+.|.   .|+.+..+..-...
T Consensus       154 ~~~~i~~~~~~~~~~~~~~~~~~~~~~~~~g~pDG~~vD~-~G~l~va~---~~~~~I~~~~p---~G~~~~~i~~p~~~  226 (246)
T PF08450_consen  154 FNGRIWRFDLDADGGELSNRRVFIDFPGGPGYPDGLAVDS-DGNLWVAD---WGGGRIVVFDP---DGKLLREIELPVPR  226 (246)
T ss_dssp             TTTEEEEEEEETTTCCEEEEEEEEE-SSSSCEEEEEEEBT-TS-EEEEE---ETTTEEEEEET---TSCEEEEEE-SSSS
T ss_pred             ccceeEEEeccccccceeeeeeEEEcCCCCcCCCcceEcC-CCCEEEEE---cCCCEEEEECC---CccEEEEEcCCCCC
Confidence            888888888864321  01122222222223466799999 99988763   25678999994   57878877766668


Q ss_pred             EEEEeec-ccch
Q 000080         2369 YDLFLPL-KLLN 2379 (2389)
Q Consensus      2369 V~svA~~-~~~~ 2379 (2389)
                      ++++++- ++++
T Consensus       227 ~t~~~fgg~~~~  238 (246)
T PF08450_consen  227 PTNCAFGGPDGK  238 (246)
T ss_dssp             EEEEEEESTTSS
T ss_pred             EEEEEEECCCCC
Confidence            9999983 4433


No 290
>KOG4714 consensus Nucleoporin [Nuclear structure]
Probab=95.16  E-value=0.014  Score=69.07  Aligned_cols=73  Identities=19%  Similarity=0.367  Sum_probs=60.4

Q ss_pred             eEEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-GHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~DgTVkLW 2298 (2389)
                      .|.+++-||..+ ++++|++||.|.|||+++..-...+  +.       .|...++.|-|.|. +..|.++|+||.+--|
T Consensus       181 ~v~~l~~hp~qq~~v~cgt~dg~~~l~d~rn~~~p~S~--l~-------ahk~~i~eV~FHpk~p~~Lft~sedGslw~w  251 (319)
T KOG4714|consen  181 AVTALCSHPAQQHLVCCGTDDGIVGLWDARNVAMPVSL--LK-------AHKAEIWEVHFHPKNPEHLFTCSEDGSLWHW  251 (319)
T ss_pred             cchhhhCCcccccEEEEecCCCeEEEEEcccccchHHH--HH-------HhhhhhhheeccCCCchheeEecCCCcEEEE
Confidence            478999999866 6888999999999999888533333  22       35688999999986 6899999999999999


Q ss_pred             eCCC
Q 000080         2299 QLEV 2302 (2389)
Q Consensus      2299 Dl~t 2302 (2389)
                      |-.+
T Consensus       252 das~  255 (319)
T KOG4714|consen  252 DAST  255 (319)
T ss_pred             cCCC
Confidence            9874


No 291
>KOG4532 consensus WD40-like repeat containing protein [General function prediction only]
Probab=95.05  E-value=0.16  Score=60.83  Aligned_cols=113  Identities=13%  Similarity=0.123  Sum_probs=83.4

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      .+.+++++||+++.++-++-..|-++.+.+..  .++++.   +.      .++.=.++.||...-.||++..||++.+|
T Consensus       160 ~~ns~~~snd~~~~~~Vgds~~Vf~y~id~~sey~~~~~~---a~------t~D~gF~~S~s~~~~~FAv~~Qdg~~~I~  230 (344)
T KOG4532|consen  160 TQNSLHYSNDPSWGSSVGDSRRVFRYAIDDESEYIENIYE---AP------TSDHGFYNSFSENDLQFAVVFQDGTCAIY  230 (344)
T ss_pred             ceeeeEEcCCCceEEEecCCCcceEEEeCCccceeeeeEe---cc------cCCCceeeeeccCcceEEEEecCCcEEEE
Confidence            35788999999999999999999999987553  344332   11      13445789999999999999999999999


Q ss_pred             eCCCCCccCcccc----eeeeecCCCeeEEEEecCCCC---EEEEeecCCCCCeEEEeeC
Q 000080         2299 QLEVGGRSNVRPM----ESCLCFSSHAMDVSYITSSGS---VIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2299 Dl~tggrs~~k~l----~tl~gHs~~V~sVAFSP~DGs---lLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |++..+    .|.    .+-.-|.+.++.+.|+| .|.   ++.|-++    +-+.|-|+
T Consensus       231 DVR~~~----tpm~~~sstrp~hnGa~R~c~Fsl-~g~lDLLf~sEhf----s~~hv~D~  281 (344)
T KOG4532|consen  231 DVRNMA----TPMAEISSTRPHHNGAFRVCRFSL-YGLLDLLFISEHF----SRVHVVDT  281 (344)
T ss_pred             Eecccc----cchhhhcccCCCCCCceEEEEecC-CCcceEEEEecCc----ceEEEEEc
Confidence            998753    122    12234899999999997 443   4445432    45777887


No 292
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=95.05  E-value=0.14  Score=67.88  Aligned_cols=112  Identities=17%  Similarity=0.178  Sum_probs=79.4

Q ss_pred             cCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-----CCEEEEEeCCCcEEEeeCCC
Q 000080         2228 HPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-----GHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2228 sPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-----G~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .-+|.++||+|.||+|.+--+.+++...++.-           .-.+.+|+|+||     .++|++|+.-| +-|..=+-
T Consensus        80 ~~~Gey~asCS~DGkv~I~sl~~~~~~~~~df-----------~rpiksial~Pd~~~~~sk~fv~GG~ag-lvL~er~w  147 (846)
T KOG2066|consen   80 ILEGEYVASCSDDGKVVIGSLFTDDEITQYDF-----------KRPIKSIALHPDFSRQQSKQFVSGGMAG-LVLSERNW  147 (846)
T ss_pred             ccCCceEEEecCCCcEEEeeccCCccceeEec-----------CCcceeEEeccchhhhhhhheeecCcce-EEEehhhh
Confidence            34699999999999999999999987665530           145899999999     57999999998 77764332


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      -+  +-..+ .+..-.+.|.++.|..   ++||=|    +|--||++|+  ++++.+..++
T Consensus       148 lg--nk~~v-~l~~~eG~I~~i~W~g---~lIAWa----nd~Gv~vyd~--~~~~~l~~i~  196 (846)
T KOG2066|consen  148 LG--NKDSV-VLSEGEGPIHSIKWRG---NLIAWA----NDDGVKVYDT--PTRQRLTNIP  196 (846)
T ss_pred             hc--Cccce-eeecCccceEEEEecC---cEEEEe----cCCCcEEEec--cccceeeccC
Confidence            22  11122 2333457899999985   899976    4455999998  3444444444


No 293
>smart00320 WD40 WD40 repeats. Note that these repeats are permuted with respect to the structural repeats (blades) of the beta propeller domain.
Probab=94.95  E-value=0.054  Score=41.52  Aligned_cols=38  Identities=18%  Similarity=0.387  Sum_probs=32.3

Q ss_pred             ccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2309 RPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2309 k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      ++...+.+|...|.+++|.+ ++++++++   +.|++|++||
T Consensus         3 ~~~~~~~~~~~~i~~~~~~~-~~~~~~~~---~~d~~~~~~~   40 (40)
T smart00320        3 ELLKTLKGHTGPVTSVAFSP-DGKYLASA---SDDGTIKLWD   40 (40)
T ss_pred             EEEEEEEecCCceeEEEECC-CCCEEEEe---cCCCeEEEcC
Confidence            35667778999999999999 77888886   5899999997


No 294
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=94.41  E-value=0.86  Score=57.34  Aligned_cols=102  Identities=14%  Similarity=0.034  Sum_probs=70.7

Q ss_pred             CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC----------CCcEEEeeCCCCCccCccc
Q 000080         2241 THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL----------DGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2241 gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~----------DgTVkLWDl~tggrs~~k~ 2310 (2389)
                      ++|.+-|..+++-+.++.+  |       .....  + +||||+.|..+..          +.+|.+||+++.     ++
T Consensus        27 ~~v~ViD~~~~~v~g~i~~--G-------~~P~~--~-~spDg~~lyva~~~~~R~~~G~~~d~V~v~D~~t~-----~~   89 (352)
T TIGR02658        27 TQVYTIDGEAGRVLGMTDG--G-------FLPNP--V-VASDGSFFAHASTVYSRIARGKRTDYVEVIDPQTH-----LP   89 (352)
T ss_pred             ceEEEEECCCCEEEEEEEc--c-------CCCce--e-ECCCCCEEEEEeccccccccCCCCCEEEEEECccC-----cE
Confidence            8999999999988877742  2       22222  4 9999988877766          899999999986     23


Q ss_pred             ceeeee-------cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2311 MESCLC-------FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2311 l~tl~g-------Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      +..+.-       ....-..++++| ||++|..+-. +.++.|-+.|+  ++++-+..+.
T Consensus        90 ~~~i~~p~~p~~~~~~~~~~~~ls~-dgk~l~V~n~-~p~~~V~VvD~--~~~kvv~ei~  145 (352)
T TIGR02658        90 IADIELPEGPRFLVGTYPWMTSLTP-DNKTLLFYQF-SPSPAVGVVDL--EGKAFVRMMD  145 (352)
T ss_pred             EeEEccCCCchhhccCccceEEECC-CCCEEEEecC-CCCCEEEEEEC--CCCcEEEEEe
Confidence            433321       122334799999 9998886532 23899999998  4555555544


No 295
>COG4946 Uncharacterized protein related to the periplasmic component of the Tol biopolymer transport system [Function unknown]
Probab=94.31  E-value=0.86  Score=58.03  Aligned_cols=103  Identities=12%  Similarity=0.003  Sum_probs=80.3

Q ss_pred             CCCCCCCEEEEEECCCCCEEEEEeCCC-cEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCe
Q 000080         2267 PPYALASISALQFDHYGHRFASAALDG-TVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGIN 2345 (2389)
Q Consensus      2267 ~~GH~~~V~sVaFSPDG~~LASgS~Dg-TVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~T 2345 (2389)
                      +.||...|+=.+|.-|++-++.|..|| .+-+.|.+++.      +.....--+.|.+|..+| ||+.++.|    +| .
T Consensus       355 qv~~~~~VrY~r~~~~~e~~vigt~dgD~l~iyd~~~~e------~kr~e~~lg~I~av~vs~-dGK~~vva----Nd-r  422 (668)
T COG4946         355 QVGKKGGVRYRRIQVDPEGDVIGTNDGDKLGIYDKDGGE------VKRIEKDLGNIEAVKVSP-DGKKVVVA----ND-R  422 (668)
T ss_pred             EcCCCCceEEEEEccCCcceEEeccCCceEEEEecCCce------EEEeeCCccceEEEEEcC-CCcEEEEE----cC-c
Confidence            567788899999999999999999999 89999999862      344445557899999999 99988874    44 3


Q ss_pred             EEEeeCCCCCCCceEEEEeecCcEEEEeecccchhh
Q 000080         2346 VVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2346 VrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~ 2381 (2389)
                      ..||=+...+++....=+...+-|+.++.||.++|+
T Consensus       423 ~el~vididngnv~~idkS~~~lItdf~~~~nsr~i  458 (668)
T COG4946         423 FELWVIDIDNGNVRLIDKSEYGLITDFDWHPNSRWI  458 (668)
T ss_pred             eEEEEEEecCCCeeEecccccceeEEEEEcCCceeE
Confidence            566654445666544446677889999999999986


No 296
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=94.04  E-value=3.6  Score=57.61  Aligned_cols=92  Identities=17%  Similarity=0.172  Sum_probs=61.3

Q ss_pred             hHHH--HhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhh-ccCCChhhHhhHhhhcccc-ccccCChhH
Q 000080         1315 NAYV--LLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLV-EKHGGPLERNLVTKFILPS-SIERGDYWL 1390 (2389)
Q Consensus      1315 NAya--LLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLy-Egd~gp~l~~lL~~~vLp~-a~~~gDrwL 1390 (2389)
                      +|||  |..+++|+.||-+|..+|.++.|+. +.+--+|.+=|+.|++.. +|.+ .+. . +-+.+... ..++...=.
T Consensus       943 ~~ya~hL~~~~~~~~Aal~Ye~~GklekAl~-a~~~~~dWr~~l~~a~ql~~~~d-e~~-~-~a~~L~s~L~e~~kh~eA 1018 (1265)
T KOG1920|consen  943 EAYADHLREELMSDEAALMYERCGKLEKALK-AYKECGDWREALSLAAQLSEGKD-ELV-I-LAEELVSRLVEQRKHYEA 1018 (1265)
T ss_pred             HHHHHHHHHhccccHHHHHHHHhccHHHHHH-HHHHhccHHHHHHHHHhhcCCHH-HHH-H-HHHHHHHHHHHcccchhH
Confidence            4554  8899999999999999999999996 566679999999988854 4432 111 1 11222221 122233345


Q ss_pred             HHHHHHHhCChhHHHHHHhc
Q 000080         1391 TSLLEWELGNYSQSFLTMLG 1410 (2389)
Q Consensus      1391 ~S~a~W~L~~~~~Av~~Ll~ 1410 (2389)
                      +.++.=-+.++.+|+..|++
T Consensus      1019 a~il~e~~sd~~~av~ll~k 1038 (1265)
T KOG1920|consen 1019 AKILLEYLSDPEEAVALLCK 1038 (1265)
T ss_pred             HHHHHHHhcCHHHHHHHHhh
Confidence            56666677888888877764


No 297
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=93.92  E-value=0.36  Score=63.22  Aligned_cols=102  Identities=17%  Similarity=0.305  Sum_probs=67.4

Q ss_pred             eEEEEecCCcEE-EEeCCC--Ccccccc---cccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe-cCCeEEEEeeC
Q 000080           54 SWVAYGASSLLV-ISHFPS--PLSQEEA---LIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA-SENCIFVFAHD  126 (2389)
Q Consensus        54 ~~vAYasg~~vV-I~~l~S--P~~~~e~---~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS-yDntIRVw~~d  126 (2389)
                      .+||+|...+++ ++-|.-  |+....-   ..-=...|.++||..  .|-.|.|+-.   ..++-.| -++.|-||---
T Consensus        27 gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~--sV~vvTWNe~---~QKLTtSDt~GlIiVWmly  101 (1189)
T KOG2041|consen   27 GYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNA--SVMVVTWNEN---NQKLTTSDTSGLIIVWMLY  101 (1189)
T ss_pred             CeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcc--eEEEEEeccc---cccccccCCCceEEEEeee
Confidence            379999766554 443332  1111000   000135699999976  8999999996   5555555 36899999765


Q ss_pred             CCCCCCCccceeeEEec-ccceEEEEeecCCCCeEEEEecc
Q 000080          127 SASSKGSFCWSQNAILV-QGTKVEAIEWTGSGDGIVAGGME  166 (2389)
Q Consensus       127 ~~~~kgd~~W~~~~tL~-hssTV~sIAWSpdG~rLaSggdD  166 (2389)
                          +|  +|...-+-. -.|+|.+++|+.+|.+|.-+-.|
T Consensus       102 ----kg--sW~EEMiNnRnKSvV~SmsWn~dG~kIcIvYeD  136 (1189)
T KOG2041|consen  102 ----KG--SWCEEMINNRNKSVVVSMSWNLDGTKICIVYED  136 (1189)
T ss_pred             ----cc--cHHHHHhhCcCccEEEEEEEcCCCcEEEEEEcc
Confidence                34  476543333 58899999999999999877666


No 298
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=93.85  E-value=0.23  Score=63.60  Aligned_cols=143  Identities=15%  Similarity=0.073  Sum_probs=92.2

Q ss_pred             eeEEEEEEcCCCCeEEEEe---CC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCCc
Q 000080         2220 ISTRAFSSHPLRPFFLVGS---SN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDGT 2294 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS---~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~DgT 2294 (2389)
                      ..+..-+|+|+++.++--+   .. ..|.++|+.+|+....+. .+++          -..-+|||||++||-. ..||.
T Consensus       193 ~~~~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~~i~~-~~g~----------~~~P~fspDG~~l~f~~~rdg~  261 (425)
T COG0823         193 SLILTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRPVILN-FNGN----------NGAPAFSPDGSKLAFSSSRDGS  261 (425)
T ss_pred             cceeccccCcCCCceEEEEEecCCCceEEEEeccCCccceeec-cCCc----------cCCccCCCCCCEEEEEECCCCC
Confidence            3456668999999765543   22 469999999998654442 2233          3556899999877755 45677


Q ss_pred             EEEe--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2295 VCTW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2295 VkLW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      ..||  |+.++   +...+....|...   .=.|+| ||+.|+-+.  +.++.-+||-+. ..+..++.+.-+.+.-..-
T Consensus       262 ~~iy~~dl~~~---~~~~Lt~~~gi~~---~Ps~sp-dG~~ivf~S--dr~G~p~I~~~~-~~g~~~~riT~~~~~~~~p  331 (425)
T COG0823         262 PDIYLMDLDGK---NLPRLTNGFGINT---SPSWSP-DGSKIVFTS--DRGGRPQIYLYD-LEGSQVTRLTFSGGGNSNP  331 (425)
T ss_pred             ccEEEEcCCCC---cceecccCCcccc---CccCCC-CCCEEEEEe--CCCCCcceEEEC-CCCCceeEeeccCCCCcCc
Confidence            6666  55543   1122233333332   445889 999999873  566666888774 3445556665555555577


Q ss_pred             eecccchhhhc
Q 000080         2373 LPLKLLNFALS 2383 (2389)
Q Consensus      2373 A~~~~~~~~~s 2383 (2389)
                      ..+|+|++++.
T Consensus       332 ~~SpdG~~i~~  342 (425)
T COG0823         332 VWSPDGDKIVF  342 (425)
T ss_pred             cCCCCCCEEEE
Confidence            88899988764


No 299
>PF07433 DUF1513:  Protein of unknown function (DUF1513);  InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=93.64  E-value=1.5  Score=54.33  Aligned_cols=148  Identities=19%  Similarity=0.142  Sum_probs=92.3

Q ss_pred             EEEEEcCCCCeEEEE--eCC-----CcEE-----------EeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC
Q 000080         2223 RAFSSHPLRPFFLVG--SSN-----THIY-----------LWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH 2284 (2389)
Q Consensus      2223 rsVAFsPdG~~LASG--S~D-----gTIR-----------LWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~ 2284 (2389)
                      ..+.+.|||+.|+.+  +-.     |..|           .=|..+|+.+.... +     |+.-|..+++-++.++||.
T Consensus       102 Hel~l~pDG~tLvVANGGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q~~-L-----p~~~~~lSiRHLa~~~~G~  175 (305)
T PF07433_consen  102 HELLLMPDGETLVVANGGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQVE-L-----PPDLHQLSIRHLAVDGDGT  175 (305)
T ss_pred             hhEEEcCCCCEEEEEcCCCccCcccCceecChhhcCCceEEEecCCCceeeeee-c-----CccccccceeeEEecCCCc
Confidence            566899999866654  322     2233           34556777655432 2     2233668899999999997


Q ss_pred             EEEEEeCCCc-------EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC
Q 000080         2285 RFASAALDGT-------VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS 2357 (2389)
Q Consensus      2285 ~LASgS~DgT-------VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~ 2357 (2389)
                      .+...=..|-       |-+++-...-+...-+-.......+.+-+|||++ +|.++|.+  +-..+.+-+||.  .++.
T Consensus       176 V~~a~Q~qg~~~~~~PLva~~~~g~~~~~~~~p~~~~~~l~~Y~gSIa~~~-~g~~ia~t--sPrGg~~~~~d~--~tg~  250 (305)
T PF07433_consen  176 VAFAMQYQGDPGDAPPLVALHRRGGALRLLPAPEEQWRRLNGYIGSIAADR-DGRLIAVT--SPRGGRVAVWDA--ATGR  250 (305)
T ss_pred             EEEEEecCCCCCccCCeEEEEcCCCcceeccCChHHHHhhCCceEEEEEeC-CCCEEEEE--CCCCCEEEEEEC--CCCC
Confidence            6666544332       3344332210000001112344568899999999 88888765  479999999997  5666


Q ss_pred             ceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2358 SRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2358 ~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      .+....-..  +..||+..++ |.+|.
T Consensus       251 ~~~~~~l~D--~cGva~~~~~-f~~ss  274 (305)
T PF07433_consen  251 LLGSVPLPD--ACGVAPTDDG-FLVSS  274 (305)
T ss_pred             EeeccccCc--eeeeeecCCc-eEEeC
Confidence            666554443  8888888888 77664


No 300
>PF02897 Peptidase_S9_N:  Prolyl oligopeptidase, N-terminal beta-propeller domain;  InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold:  Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases.   In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding.  Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs.  Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=93.62  E-value=2.4  Score=53.36  Aligned_cols=143  Identities=15%  Similarity=0.099  Sum_probs=83.1

Q ss_pred             eeEEEEEEcCCCCeEEEE-----eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC-
Q 000080         2220 ISTRAFSSHPLRPFFLVG-----SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG- 2293 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASG-----S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg- 2293 (2389)
                      ..+...+++|||+++|-+     ++..+|++.|+.+|+.+..--  +.         ..-..+.|.+||+.|.-...|. 
T Consensus       124 ~~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~~l~d~i--~~---------~~~~~~~W~~d~~~~~y~~~~~~  192 (414)
T PF02897_consen  124 VSLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGKFLPDGI--EN---------PKFSSVSWSDDGKGFFYTRFDED  192 (414)
T ss_dssp             EEEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTEEEEEEE--EE---------EESEEEEECTTSSEEEEEECSTT
T ss_pred             EEeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCcCcCCcc--cc---------cccceEEEeCCCCEEEEEEeCcc
Confidence            345678999999987743     344669999999998765421  11         1113499999999887776554 


Q ss_pred             ----------cEEEeeCCCCCccCcccceeeeecCCC--eeEEEEecCCCCEEEEeecCCCC-CeEEEeeCCCC--CCCc
Q 000080         2294 ----------TVCTWQLEVGGRSNVRPMESCLCFSSH--AMDVSYITSSGSVIAAAGHSSNG-INVVVWDTLAP--PTSS 2358 (2389)
Q Consensus      2294 ----------TVkLWDl~tggrs~~k~l~tl~gHs~~--V~sVAFSP~DGslLASAG~sS~D-~TVrLWD~l~~--tg~~ 2358 (2389)
                                .|++|.+.++. +  ....-+++....  ..++..++ ||++|.....+..+ ..|.+=|+...  ....
T Consensus       193 ~~~~~~~~~~~v~~~~~gt~~-~--~d~lvfe~~~~~~~~~~~~~s~-d~~~l~i~~~~~~~~s~v~~~d~~~~~~~~~~  268 (414)
T PF02897_consen  193 QRTSDSGYPRQVYRHKLGTPQ-S--EDELVFEEPDEPFWFVSVSRSK-DGRYLFISSSSGTSESEVYLLDLDDGGSPDAK  268 (414)
T ss_dssp             TSS-CCGCCEEEEEEETTS-G-G--G-EEEEC-TTCTTSEEEEEE-T-TSSEEEEEEESSSSEEEEEEEECCCTTTSS-S
T ss_pred             cccccCCCCcEEEEEECCCCh-H--hCeeEEeecCCCcEEEEEEecC-cccEEEEEEEccccCCeEEEEeccccCCCcCC
Confidence                      38899998752 1  212223333322  45788888 88987643323344 55777776311  1123


Q ss_pred             eEEEEeecCcEEEEeeccc
Q 000080         2359 RASITCHEGLYDLFLPLKL 2377 (2389)
Q Consensus      2359 v~sL~GH~~~V~svA~~~~ 2377 (2389)
                      ...+.-+..++....-+..
T Consensus       269 ~~~l~~~~~~~~~~v~~~~  287 (414)
T PF02897_consen  269 PKLLSPREDGVEYYVDHHG  287 (414)
T ss_dssp             EEEEEESSSS-EEEEEEET
T ss_pred             cEEEeCCCCceEEEEEccC
Confidence            5555555555554443333


No 301
>PF08450 SGL:  SMP-30/Gluconolaconase/LRE-like region;  InterPro: IPR013658 This family describes a region that is found in proteins expressed by a variety of eukaryotic and prokaryotic species. These proteins include various enzymes, such as senescence marker protein 30 (SMP-30, Q15493 from SWISSPROT), gluconolactonase (Q01578 from SWISSPROT) and luciferin-regenerating enzyme (LRE, Q86DU5 from SWISSPROT). SMP-30 is known to hydrolyse diisopropyl phosphorofluoridate in the liver, and has been noted as having sequence similarity, in the region described in this family, with PON1 (P52430 from SWISSPROT) and LRE. ; PDB: 2GHS_A 2DG0_L 2DG1_D 2DSO_D 3E5Z_A 2IAT_A 2IAV_A 2GVV_A 3HLI_A 2GVU_A ....
Probab=93.15  E-value=2.4  Score=49.48  Aligned_cols=137  Identities=12%  Similarity=0.078  Sum_probs=84.6

Q ss_pred             EEEEcC-CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEEEEeCCCcEEEeeCC
Q 000080         2224 AFSSHP-LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2224 sVAFsP-dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      .++|.+ +|.++.+.-..+.|.-||..+++.. .+. +           .....+++. ++|+.+++ ..++ +.+.|.+
T Consensus         4 gp~~d~~~g~l~~~D~~~~~i~~~~~~~~~~~-~~~-~-----------~~~~G~~~~~~~g~l~v~-~~~~-~~~~d~~   68 (246)
T PF08450_consen    4 GPVWDPRDGRLYWVDIPGGRIYRVDPDTGEVE-VID-L-----------PGPNGMAFDRPDGRLYVA-DSGG-IAVVDPD   68 (246)
T ss_dssp             EEEEETTTTEEEEEETTTTEEEEEETTTTEEE-EEE-S-----------SSEEEEEEECTTSEEEEE-ETTC-EEEEETT
T ss_pred             ceEEECCCCEEEEEEcCCCEEEEEECCCCeEE-EEe-c-----------CCCceEEEEccCCEEEEE-EcCc-eEEEecC
Confidence            458998 8888898889999999999776543 332 1           126788888 67655554 4444 4555998


Q ss_pred             CCCccCcccceeee--e-cCCCeeEEEEecCCCCEEEEeecCCC-CCe--EEEeeCCCCCCCceEEEEeecCcEEEEeec
Q 000080         2302 VGGRSNVRPMESCL--C-FSSHAMDVSYITSSGSVIAAAGHSSN-GIN--VVVWDTLAPPTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2302 tggrs~~k~l~tl~--g-Hs~~V~sVAFSP~DGslLASAG~sS~-D~T--VrLWD~l~~tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      ++.   .+.+....  . .....+++++.| +|++.+|...... ...  =+||.+. +. ..+..+...-...+.++++
T Consensus        69 ~g~---~~~~~~~~~~~~~~~~~ND~~vd~-~G~ly~t~~~~~~~~~~~~g~v~~~~-~~-~~~~~~~~~~~~pNGi~~s  142 (246)
T PF08450_consen   69 TGK---VTVLADLPDGGVPFNRPNDVAVDP-DGNLYVTDSGGGGASGIDPGSVYRID-PD-GKVTVVADGLGFPNGIAFS  142 (246)
T ss_dssp             TTE---EEEEEEEETTCSCTEEEEEEEE-T-TS-EEEEEECCBCTTCGGSEEEEEEE-TT-SEEEEEEEEESSEEEEEEE
T ss_pred             CCc---EEEEeeccCCCcccCCCceEEEcC-CCCEEEEecCCCccccccccceEEEC-CC-CeEEEEecCcccccceEEC
Confidence            862   23444432  1 345678999999 9998887421100 000  2344442 22 3355555556777899999


Q ss_pred             ccchhh
Q 000080         2376 KLLNFA 2381 (2389)
Q Consensus      2376 ~~~~~~ 2381 (2389)
                      ++|+..
T Consensus       143 ~dg~~l  148 (246)
T PF08450_consen  143 PDGKTL  148 (246)
T ss_dssp             TTSSEE
T ss_pred             Ccchhe
Confidence            999853


No 302
>KOG1409 consensus Uncharacterized conserved protein, contains WD40 repeats and FYVE domains [Function unknown]
Probab=93.03  E-value=1  Score=55.78  Aligned_cols=158  Identities=13%  Similarity=0.095  Sum_probs=110.3

Q ss_pred             cccccccccccccCCC------CcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc----eeeEecccCCCCCCCCC
Q 000080         2200 GWETQDDFEDYVDPPA------TVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK----ATATYGVLPAANVPPPY 2269 (2389)
Q Consensus      2200 ~~d~~~~~~~~~d~~a------tv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk----~l~Tl~vl~gh~~p~~G 2269 (2389)
                      +.|.++|+|-=.|.-.      +....+++++++++..+.|..|=++|++.-+-+...-    .++.+          +.
T Consensus        43 s~drtvrv~lkrds~q~wpsI~~~mP~~~~~~~y~~e~~~L~vg~~ngtvtefs~sedfnkm~~~r~~----------~~  112 (404)
T KOG1409|consen   43 SEDRTVRVWLKRDSGQYWPSIYHYMPSPCSAMEYVSESRRLYVGQDNGTVTEFALSEDFNKMTFLKDY----------LA  112 (404)
T ss_pred             cccceeeeEEeccccccCchhhhhCCCCceEeeeeccceEEEEEEecceEEEEEhhhhhhhcchhhhh----------hh
Confidence            5566666663322222      2222467999999999999999999999998775432    22333          24


Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC----------------------------C--------ccCccccee
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVG----------------------------G--------RSNVRPMES 2313 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg----------------------------g--------rs~~k~l~t 2313 (2389)
                      |...|..+-|+---.++.+++.|..+.===.+.+                            +        .....++.+
T Consensus       113 h~~~v~~~if~~~~e~V~s~~~dk~~~~hc~e~~~~lg~Y~~~~~~t~~~~d~~~~fvGd~~gqvt~lr~~~~~~~~i~~  192 (404)
T KOG1409|consen  113 HQARVSAIVFSLTHEWVLSTGKDKQFAWHCTESGNRLGGYNFETPASALQFDALYAFVGDHSGQITMLKLEQNGCQLITT  192 (404)
T ss_pred             hhcceeeEEecCCceeEEEeccccceEEEeeccCCcccceEeeccCCCCceeeEEEEecccccceEEEEEeecCCceEEE
Confidence            6799999999988889999988866541111111                            0        023467888


Q ss_pred             eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEe
Q 000080         2314 CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFL 2373 (2389)
Q Consensus      2314 l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA 2373 (2389)
                      +.+|.+.+++.++.| .-.+|-|+   +.|..|-+||+-  -.+. ...++||.+.|+.+.
T Consensus       193 ~~~h~~~~~~l~Wd~-~~~~LfSg---~~d~~vi~wdig--g~~g~~~el~gh~~kV~~l~  247 (404)
T KOG1409|consen  193 FNGHTGEVTCLKWDP-GQRLLFSG---ASDHSVIMWDIG--GRKGTAYELQGHNDKVQALS  247 (404)
T ss_pred             EcCcccceEEEEEcC-CCcEEEec---cccCceEEEecc--CCcceeeeeccchhhhhhhh
Confidence            999999999999999 44666664   689999999983  2223 577899998887553


No 303
>KOG1920 consensus IkappaB kinase complex, IKAP component [Transcription]
Probab=92.96  E-value=1.9  Score=60.05  Aligned_cols=117  Identities=14%  Similarity=0.173  Sum_probs=81.1

Q ss_pred             HhccCCc-chhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhh-cccChHHHHHHHHhhHHHHhhcchhHHHHHHHHhc
Q 000080         1258 YLKKKDP-KDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLS-RNFQEEKNKAAALKNAYVLLGRHQLELAIAFFLLG 1335 (2389)
Q Consensus      1258 y~~~kDP-~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLs-nDFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLLA 1335 (2389)
                      +...+-+ .++||+|.-.||..--..-||.+++=++  .+.-.. -.+..+.-+.-|.+=+=.|.-+||+..||---++.
T Consensus       948 hL~~~~~~~~Aal~Ye~~GklekAl~a~~~~~dWr~--~l~~a~ql~~~~de~~~~a~~L~s~L~e~~kh~eAa~il~e~ 1025 (1265)
T KOG1920|consen  948 HLREELMSDEAALMYERCGKLEKALKAYKECGDWRE--ALSLAAQLSEGKDELVILAEELVSRLVEQRKHYEAAKILLEY 1025 (1265)
T ss_pred             HHHHhccccHHHHHHHHhccHHHHHHHHHHhccHHH--HHHHHHhhcCCHHHHHHHHHHHHHHHHHcccchhHHHHHHHH
Confidence            3333334 4699999999999888888998775332  222222 25667777777788888888899998888777664


Q ss_pred             -CChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhcccccc
Q 000080         1336 -GDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSI 1383 (2389)
Q Consensus      1336 -g~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~ 1383 (2389)
                       ++.+.||.++++- .-..-|+-+|++++.++      ++++.+.|.+.
T Consensus      1026 ~sd~~~av~ll~ka-~~~~eAlrva~~~~~~d------~iee~l~~al~ 1067 (1265)
T KOG1920|consen 1026 LSDPEEAVALLCKA-KEWEEALRVASKAKRDD------IIEEVLKPALL 1067 (1265)
T ss_pred             hcCHHHHHHHHhhH-hHHHHHHHHHHhcccch------HHHHHHhHHHH
Confidence             5788999998864 44556888888887553      45555544443


No 304
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=92.92  E-value=0.32  Score=62.20  Aligned_cols=137  Identities=12%  Similarity=0.123  Sum_probs=89.8

Q ss_pred             CceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCC----
Q 000080         2218 ENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDG---- 2293 (2389)
Q Consensus      2218 ~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~Dg---- 2293 (2389)
                      ++-+++.+.+||.|.+|++.-. .-|.+|+-..+..+..+.           | ..|.-+.|||.|+.|.+=+...    
T Consensus        31 ~~~p~~~~~~SP~G~~l~~~~~-~~V~~~~g~~~~~l~~~~-----------~-~~V~~~~fSP~~kYL~tw~~~pi~~p   97 (561)
T COG5354          31 ENWPVAYVSESPLGTYLFSEHA-AGVECWGGPSKAKLVRFR-----------H-PDVKYLDFSPNEKYLVTWSREPIIEP   97 (561)
T ss_pred             cCcchhheeecCcchheehhhc-cceEEccccchhheeeee-----------c-CCceecccCcccceeeeeccCCccCh
Confidence            3457788999999999998544 459999977665444442           3 6699999999999999976543    


Q ss_pred             -----------cEEEeeCCCCCccCcccceeeeecCCC--ee-EEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCC--
Q 000080         2294 -----------TVCTWQLEVGGRSNVRPMESCLCFSSH--AM-DVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTS-- 2357 (2389)
Q Consensus      2294 -----------TVkLWDl~tggrs~~k~l~tl~gHs~~--V~-sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~-- 2357 (2389)
                                 .+++||+.+|     ..+.++.+-...  .+ -+.|+- |..+.|=-    -...+.|.++. +.-.  
T Consensus        98 e~e~sp~~~~n~~~vwd~~sg-----~iv~sf~~~~q~~~~Wp~~k~s~-~D~y~ARv----v~~sl~i~e~t-~n~~~~  166 (561)
T COG5354          98 EIEISPFTSKNNVFVWDIASG-----MIVFSFNGISQPYLGWPVLKFSI-DDKYVARV----VGSSLYIHEIT-DNIEEH  166 (561)
T ss_pred             hhccCCccccCceeEEeccCc-----eeEeeccccCCcccccceeeeee-cchhhhhh----ccCeEEEEecC-CccccC
Confidence                       4999999987     234444433333  34 467887 55766643    23468898841 1100  


Q ss_pred             ceEEEEeecCcEEEEeecccchh
Q 000080         2358 SRASITCHEGLYDLFLPLKLLNF 2380 (2389)
Q Consensus      2358 ~v~sL~GH~~~V~svA~~~~~~~ 2380 (2389)
                      ..+.|.  ..+|..++.+|-||-
T Consensus       167 p~~~lr--~~gi~dFsisP~~n~  187 (561)
T COG5354         167 PFKNLR--PVGILDFSISPEGNH  187 (561)
T ss_pred             chhhcc--ccceeeEEecCCCCC
Confidence            022222  356777777776653


No 305
>KOG2314 consensus Translation initiation factor 3, subunit b (eIF-3b) [Translation, ribosomal structure and biogenesis]
Probab=92.63  E-value=0.52  Score=60.84  Aligned_cols=106  Identities=11%  Similarity=0.177  Sum_probs=77.2

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-----------
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL----------- 2291 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~----------- 2291 (2389)
                      .-|.|||-|.+|+|=-.-| |.||-=.+-..++.|           +| ..|.-|.|||.-++|+|=|.           
T Consensus       214 tyv~wSP~GTYL~t~Hk~G-I~lWGG~~f~r~~RF-----------~H-p~Vq~idfSP~EkYLVT~s~~p~~~~~~d~e  280 (698)
T KOG2314|consen  214 TYVRWSPKGTYLVTFHKQG-IALWGGESFDRIQRF-----------YH-PGVQFIDFSPNEKYLVTYSPEPIIVEEDDNE  280 (698)
T ss_pred             eeEEecCCceEEEEEeccc-eeeecCccHHHHHhc-----------cC-CCceeeecCCccceEEEecCCccccCcccCC
Confidence            4579999999999977666 899984433444544           24 55999999999999999653           


Q ss_pred             CCcEEEeeCCCCCccCcccceeeee--cCCCee-EEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCLC--FSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~g--Hs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ...+++||++||.     ..+++.+  -...++ =+.||. |++++|.-+    .++|-|+++
T Consensus       281 ~~~l~IWDI~tG~-----lkrsF~~~~~~~~~WP~frWS~-DdKy~Arm~----~~sisIyEt  333 (698)
T KOG2314|consen  281 GQQLIIWDIATGL-----LKRSFPVIKSPYLKWPIFRWSH-DDKYFARMT----GNSISIYET  333 (698)
T ss_pred             CceEEEEEccccc-----hhcceeccCCCccccceEEecc-CCceeEEec----cceEEEEec
Confidence            2679999999983     2333333  223333 377888 889999853    368999996


No 306
>PF12657 TFIIIC_delta:  Transcription factor IIIC subunit delta N-term;  InterPro: IPR024761  This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=92.41  E-value=1.3  Score=50.11  Aligned_cols=99  Identities=20%  Similarity=0.274  Sum_probs=58.3

Q ss_pred             CCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcc---------------c----ccccccccc-----eeeeeccCC
Q 000080           38 TRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLS---------------Q----EEALIGPIF-----RQVFALSDN   93 (2389)
Q Consensus        38 ~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~---------------~----~e~~~~p~~-----~Qviegh~d   93 (2389)
                      ....++++||+|  |  -+|.+++..|.|+....|..               .    .+.+.++.+     ....+...+
T Consensus         4 ps~~~~l~WS~D--g--~laV~t~~~v~IL~~~~P~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~   79 (173)
T PF12657_consen    4 PSCPNALAWSED--G--QLAVATGESVHILDPQTPNSLSKSFIPRPLTLPPSSIQWPITSIRRNLFTSSEWPTESPRSMD   79 (173)
T ss_pred             CCCCcCeeECCC--C--CEEEEcCCeEEEEeccCCcccccccccCCcccccccCCCccceEecCccccccCceecccccc
Confidence            345689999999  7  59999999999993222330               0    111111222     011111111


Q ss_pred             C-----CCeeEEEEcCC--CCCCCcEEE--ecCCeEEEEeeCCCCCCCCccceeeEEec
Q 000080           94 S-----LPVTSISWSPE--TPSIGQLAA--ASENCIFVFAHDSASSKGSFCWSQNAILV  143 (2389)
Q Consensus        94 ~-----~dVk~VaWSPd--~~~~GeIaA--SyDntIRVw~~d~~~~kgd~~W~~~~tL~  143 (2389)
                      .     ..|..++|||-  .+.+++++|  ..++.|.||.+....   .-.|.+...+.
T Consensus        80 ~~~~s~~~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~~~---~~~W~~v~dvs  135 (173)
T PF12657_consen   80 DEEISSSQVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPGNP---QGEWNRVADVS  135 (173)
T ss_pred             ccccccccEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCCCc---cccEeeeeehh
Confidence            0     26999999993  112245665  468999999987211   34688877664


No 307
>KOG2041 consensus WD40 repeat protein [General function prediction only]
Probab=92.30  E-value=0.62  Score=61.19  Aligned_cols=122  Identities=16%  Similarity=0.225  Sum_probs=83.4

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCC-C----CCCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAA-N----VPPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh-~----~p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
                      .+|+....++|+-+..+||.|+.||.+|+-.+++...-....++.+. +    -..-||.+.|+-|.++.+.+.|-|...
T Consensus        12 PnnvkL~c~~WNke~gyIAcgG~dGlLKVlKl~t~t~d~~~~glaa~snLsmNQtLeGH~~sV~vvTWNe~~QKLTtSDt   91 (1189)
T KOG2041|consen   12 PNNVKLHCAEWNKESGYIACGGADGLLKVLKLGTDTTDLNKSGLAAASNLSMNQTLEGHNASVMVVTWNENNQKLTTSDT   91 (1189)
T ss_pred             CCCceEEEEEEcccCCeEEeccccceeEEEEccccCCcccccccccccccchhhhhccCcceEEEEEeccccccccccCC
Confidence            34577789999999999999999999999988755321111110000 0    024578899999999999999999999


Q ss_pred             CCcEEEeeCCCCCccCcccceeee--ecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCL--CFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~--gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                      +|-|-+|-+-.|.     ....+.  --.+-|.+++|.. ||+.|+-+   -+||.|-
T Consensus        92 ~GlIiVWmlykgs-----W~EEMiNnRnKSvV~SmsWn~-dG~kIcIv---YeDGavI  140 (1189)
T KOG2041|consen   92 SGLIIVWMLYKGS-----WCEEMINNRNKSVVVSMSWNL-DGTKICIV---YEDGAVI  140 (1189)
T ss_pred             CceEEEEeeeccc-----HHHHHhhCcCccEEEEEEEcC-CCcEEEEE---EccCCEE
Confidence            9999999887651     111110  0123466777777 77777654   3555553


No 308
>TIGR02658 TTQ_MADH_Hv methylamine dehydrogenase heavy chain. This family consists of the heavy chain of methylamine dehydrogenase light chain, a periplasmic enzyme. The enzyme contains a tryptophan tryptophylquinone (TTQ) prothetic group derived from two Trp residues in the light subunity. The enzyme forms a complex with the type I blue copper protein amicyanin and a cytochrome. Electron transfer procedes from TQQ to the copper and then to the heme group of the cytochrome.
Probab=92.30  E-value=2.6  Score=53.18  Aligned_cols=121  Identities=9%  Similarity=0.118  Sum_probs=76.8

Q ss_pred             EEcC-CCCeEEEEeCCCcEEEeecCCCc-----eeeEeccc-CCCCCCCCCCCCCEEEEEECCCCCEEEEEe--------
Q 000080         2226 SSHP-LRPFFLVGSSNTHIYLWEFGKDK-----ATATYGVL-PAANVPPPYALASISALQFDHYGHRFASAA-------- 2290 (2389)
Q Consensus      2226 AFsP-dG~~LASGS~DgTIRLWDl~tGk-----~l~Tl~vl-~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-------- 2290 (2389)
                      .|.| ||+++..... |+|.+=|+....     ...++..- +.....|    ....-++++|||+++-.+.        
T Consensus       200 ~~~~~dg~~~~vs~e-G~V~~id~~~~~~~~~~~~~~~~~~~~~~~wrP----~g~q~ia~~~dg~~lyV~~~~~~~~th  274 (352)
T TIGR02658       200 AYSNKSGRLVWPTYT-GKIFQIDLSSGDAKFLPAIEAFTEAEKADGWRP----GGWQQVAYHRARDRIYLLADQRAKWTH  274 (352)
T ss_pred             ceEcCCCcEEEEecC-CeEEEEecCCCcceecceeeeccccccccccCC----CcceeEEEcCCCCEEEEEecCCccccc
Confidence            4566 8887766555 999999964332     22222100 0000111    3345599999998877743        


Q ss_pred             --CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080         2291 --LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus      2291 --~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
                        ..+.|.++|.+++.     .+..+. -...+..++|+| ||+ +|.++  ...+++|.+-|+  ++++.++++
T Consensus       275 k~~~~~V~ViD~~t~k-----vi~~i~-vG~~~~~iavS~-Dgkp~lyvt--n~~s~~VsViD~--~t~k~i~~i  338 (352)
T TIGR02658       275 KTASRFLFVVDAKTGK-----RLRKIE-LGHEIDSINVSQ-DAKPLLYAL--STGDKTLYIFDA--ETGKELSSV  338 (352)
T ss_pred             cCCCCEEEEEECCCCe-----EEEEEe-CCCceeeEEECC-CCCeEEEEe--CCCCCcEEEEEC--cCCeEEeee
Confidence              22579999999862     333332 234788999999 888 66654  236788999997  566777776


No 309
>PF14783 BBS2_Mid:  Ciliary BBSome complex subunit 2, middle region
Probab=92.25  E-value=3  Score=45.13  Aligned_cols=65  Identities=25%  Similarity=0.219  Sum_probs=48.1

Q ss_pred             EEEEEEcC---CCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2222 TRAFSSHP---LRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2222 VrsVAFsP---dG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      |+++++..   ||+ .|+.||+|..||+|+  ....+..+..           .+.|.+++-... .+||-|-.+|||-+
T Consensus         2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~--~~e~~~Ei~e-----------~~~v~~L~~~~~-~~F~Y~l~NGTVGv   67 (111)
T PF14783_consen    2 VTALCLFDFDGDGENELLVGSDDFEIRVFK--GDEIVAEITE-----------TDKVTSLCSLGG-GRFAYALANGTVGV   67 (111)
T ss_pred             eeEEEEEecCCCCcceEEEecCCcEEEEEe--CCcEEEEEec-----------ccceEEEEEcCC-CEEEEEecCCEEEE
Confidence            46666665   443 799999999999998  3466666641           266888877776 57999999998876


Q ss_pred             eeC
Q 000080         2298 WQL 2300 (2389)
Q Consensus      2298 WDl 2300 (2389)
                      +|-
T Consensus        68 Y~~   70 (111)
T PF14783_consen   68 YDR   70 (111)
T ss_pred             EeC
Confidence            644


No 310
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=92.05  E-value=0.25  Score=61.78  Aligned_cols=99  Identities=18%  Similarity=0.241  Sum_probs=74.3

Q ss_pred             CCCCCCEEEEEECCCCC-EEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2268 PYALASISALQFDHYGH-RFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2268 ~GH~~~V~sVaFSPDG~-~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      ++|...|+.++|||..+ .+..++.+++|+|-|+++.     ....++..| ..+++++|.-++...|- ||  -..|.|
T Consensus       190 p~~g~~IrdlafSp~~~GLl~~asl~nkiki~dlet~-----~~vssy~a~-~~~wSC~wDlde~h~IY-aG--l~nG~V  260 (463)
T KOG1645|consen  190 PGEGSFIRDLAFSPFNEGLLGLASLGNKIKIMDLETS-----CVVSSYIAY-NQIWSCCWDLDERHVIY-AG--LQNGMV  260 (463)
T ss_pred             cccchhhhhhccCccccceeeeeccCceEEEEecccc-----eeeeheecc-CCceeeeeccCCcceeE-Ee--ccCceE
Confidence            45668899999999988 7999999999999999984     355666667 78999999996666665 45  378999


Q ss_pred             EEeeCCCCCCCceEEEEe--ecCcEEEEeecc
Q 000080         2347 VVWDTLAPPTSSRASITC--HEGLYDLFLPLK 2376 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~G--H~~~V~svA~~~ 2376 (2389)
                      -++|+..+ ...++.+.+  -.+.|..|+|.+
T Consensus       261 lvyD~R~~-~~~~~e~~a~~t~~pv~~i~~~~  291 (463)
T KOG1645|consen  261 LVYDMRQP-EGPLMELVANVTINPVHKIAPVQ  291 (463)
T ss_pred             EEEEccCC-CchHhhhhhhhccCcceeecccC
Confidence            99999643 334555544  334566666543


No 311
>KOG1645 consensus RING-finger-containing E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=91.90  E-value=0.56  Score=58.89  Aligned_cols=111  Identities=14%  Similarity=0.214  Sum_probs=80.2

Q ss_pred             EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-CEEEEEeCCCcEEEee
Q 000080         2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-HRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-~~LASgS~DgTVkLWD 2299 (2389)
                      ||.++|+|..+ ++..+|-+.+|+|.|+++-.++.+|.   +       | ..+++.+|.-|. +.+-.|...|.|.++|
T Consensus       196 IrdlafSp~~~GLl~~asl~nkiki~dlet~~~vssy~---a-------~-~~~wSC~wDlde~h~IYaGl~nG~VlvyD  264 (463)
T KOG1645|consen  196 IRDLAFSPFNEGLLGLASLGNKIKIMDLETSCVVSSYI---A-------Y-NQIWSCCWDLDERHVIYAGLQNGMVLVYD  264 (463)
T ss_pred             hhhhccCccccceeeeeccCceEEEEecccceeeehee---c-------c-CCceeeeeccCCcceeEEeccCceEEEEE
Confidence            48899999988 88999999999999999888888874   2       2 679999999885 7888999999999999


Q ss_pred             CCCCCccCcccceeeee--cCCCeeEEEEecC-----CCCEEEEeecCCCCCeEEEeeCC
Q 000080         2300 LEVGGRSNVRPMESCLC--FSSHAMDVSYITS-----SGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~g--Hs~~V~sVAFSP~-----DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      ++...    .++..+.+  -..+|-.|+..++     .|.+|+.+   +.+  ..-|++.
T Consensus       265 ~R~~~----~~~~e~~a~~t~~pv~~i~~~~~n~~f~~gglLv~~---lt~--l~f~ei~  315 (463)
T KOG1645|consen  265 MRQPE----GPLMELVANVTINPVHKIAPVQPNKIFTSGGLLVFA---LTV--LQFYEIV  315 (463)
T ss_pred             ccCCC----chHhhhhhhhccCcceeecccCccccccccceEEee---ehh--hhhhhhh
Confidence            98753    23333333  1223333333332     56777654   233  5678863


No 312
>KOG1912 consensus WD40 repeat protein [General function prediction only]
Probab=91.58  E-value=1  Score=60.10  Aligned_cols=128  Identities=12%  Similarity=0.177  Sum_probs=87.6

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC------------CEEEEEe
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG------------HRFASAA 2290 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG------------~~LASgS 2290 (2389)
                      .++.|+|.| +||-|| ...|-+=|..+-+.++++.          -|...|++|.+.|--            -.||+++
T Consensus        19 ~A~Dw~~~G-LiAygs-hslV~VVDs~s~q~iqsie----------~h~s~V~~VrWap~~~p~~llS~~~~~lliAsaD   86 (1062)
T KOG1912|consen   19 NAADWSPSG-LIAYGS-HSLVSVVDSRSLQLIQSIE----------LHQSAVTSVRWAPAPSPRDLLSPSSSQLLIASAD   86 (1062)
T ss_pred             cccccCccc-eEEEec-CceEEEEehhhhhhhhccc----------cCccceeEEEeccCCCchhccCccccceeEEecc
Confidence            567999987 444444 4478899988778777763          256889999987632            2788999


Q ss_pred             CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecC--CC-CEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecC
Q 000080         2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITS--SG-SVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEG 2367 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~--DG-slLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~ 2367 (2389)
                      ..|.|-|||...+.     ..--++.|.+.+-+++|.|.  +. .+|+.=   ..-.+|.||++  .+|+.+.....-+.
T Consensus        87 ~~GrIil~d~~~~s-----~~~~l~~~~~~~qdl~W~~~rd~Srd~LlaI---h~ss~lvLwnt--dtG~k~Wk~~ys~~  156 (1062)
T KOG1912|consen   87 ISGRIILVDFVLAS-----VINWLSHSNDSVQDLCWVPARDDSRDVLLAI---HGSSTLVLWNT--DTGEKFWKYDYSHE  156 (1062)
T ss_pred             ccCcEEEEEehhhh-----hhhhhcCCCcchhheeeeeccCcchheeEEe---cCCcEEEEEEc--cCCceeeccccCCc
Confidence            99999999999862     33445668899999999864  33 344332   23479999987  35666655443333


Q ss_pred             cEEEE
Q 000080         2368 LYDLF 2372 (2389)
Q Consensus      2368 ~V~sv 2372 (2389)
                      -..|+
T Consensus       157 iLs~f  161 (1062)
T KOG1912|consen  157 ILSCF  161 (1062)
T ss_pred             ceeee
Confidence            33333


No 313
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=91.40  E-value=0.35  Score=64.26  Aligned_cols=107  Identities=15%  Similarity=0.184  Sum_probs=82.5

Q ss_pred             EEEcCCCCeEEEEe----CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2225 FSSHPLRPFFLVGS----SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2225 VAFsPdG~~LASGS----~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      ++|||..|++|.+|    ..|.|.|+- .+|+.-+... .|-       |   ++++++.|.--.||+|=+-|.+.+|..
T Consensus        21 ~SWHPsePlfAVA~fS~er~GSVtIfa-dtGEPqr~Vt-~P~-------h---atSLCWHpe~~vLa~gwe~g~~~v~~~   88 (1416)
T KOG3617|consen   21 SSWHPSEPLFAVASFSPERGGSVTIFA-DTGEPQRDVT-YPV-------H---ATSLCWHPEEFVLAQGWEMGVSDVQKT   88 (1416)
T ss_pred             cccCCCCceeEEEEecCCCCceEEEEe-cCCCCCcccc-cce-------e---hhhhccChHHHHHhhccccceeEEEec
Confidence            48999999999888    567888886 4666433221 122       2   688999999999999999999999988


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      ++.+     ...-..-|...+.-+.||| +|+.|.|+   -.=+.|-+|...
T Consensus        89 ~~~e-----~htv~~th~a~i~~l~wS~-~G~~l~t~---d~~g~v~lwr~d  131 (1416)
T KOG3617|consen   89 NTTE-----THTVVETHPAPIQGLDWSH-DGTVLMTL---DNPGSVHLWRYD  131 (1416)
T ss_pred             CCce-----eeeeccCCCCCceeEEecC-CCCeEEEc---CCCceeEEEEee
Confidence            7642     2222345889999999999 99999996   366789999974


No 314
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=91.37  E-value=0.58  Score=61.29  Aligned_cols=75  Identities=19%  Similarity=0.252  Sum_probs=60.3

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +.|..+.|+|--.+||.+..+|.|-+.-+. -+.+.++        |.||- +.++++++.|||+.||.|=.||||+|-|
T Consensus        21 ~~i~~~ewnP~~dLiA~~t~~gelli~R~n-~qRlwti--------p~p~~-~v~~sL~W~~DGkllaVg~kdG~I~L~D   90 (665)
T KOG4640|consen   21 INIKRIEWNPKMDLIATRTEKGELLIHRLN-WQRLWTI--------PIPGE-NVTASLCWRPDGKLLAVGFKDGTIRLHD   90 (665)
T ss_pred             cceEEEEEcCccchhheeccCCcEEEEEec-cceeEec--------cCCCC-ccceeeeecCCCCEEEEEecCCeEEEEE
Confidence            356889999999999999999999887765 4455555        11221 2235999999999999999999999999


Q ss_pred             CCCCC
Q 000080         2300 LEVGG 2304 (2389)
Q Consensus      2300 l~tgg 2304 (2389)
                      +++|+
T Consensus        91 ve~~~   95 (665)
T KOG4640|consen   91 VEKGG   95 (665)
T ss_pred             ccCCC
Confidence            99985


No 315
>PRK02888 nitrous-oxide reductase; Validated
Probab=90.93  E-value=1.8  Score=57.87  Aligned_cols=143  Identities=12%  Similarity=0.114  Sum_probs=83.7

Q ss_pred             cCCCCeEEEEeCCCcEEEeecCC----CceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEE-EeCCCcEEEeeCCC
Q 000080         2228 HPLRPFFLVGSSNTHIYLWEFGK----DKATATYGVLPAANVPPPYALASISALQFDHYGHRFAS-AALDGTVCTWQLEV 2302 (2389)
Q Consensus      2228 sPdG~~LASGS~DgTIRLWDl~t----Gk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LAS-gS~DgTVkLWDl~t 2302 (2389)
                      .++|++...  .+++|.+.|..+    +..+..+-  |..        ...+.|++||||+++.. +..+++|.+-|+++
T Consensus       285 vkdGK~~~V--~gn~V~VID~~t~~~~~~~v~~yI--PVG--------KsPHGV~vSPDGkylyVanklS~tVSVIDv~k  352 (635)
T PRK02888        285 VKAGKFKTI--GGSKVPVVDGRKAANAGSALTRYV--PVP--------KNPHGVNTSPDGKYFIANGKLSPTVTVIDVRK  352 (635)
T ss_pred             hhCCCEEEE--CCCEEEEEECCccccCCcceEEEE--ECC--------CCccceEECCCCCEEEEeCCCCCcEEEEEChh
Confidence            346665444  367899999887    43333321  211        45689999999986655 55699999999987


Q ss_pred             CCc---cCcccceeeeec---CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC----CC----CceEEEEeecCc
Q 000080         2303 GGR---SNVRPMESCLCF---SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP----PT----SSRASITCHEGL 2368 (2389)
Q Consensus      2303 ggr---s~~k~l~tl~gH---s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~----tg----~~v~sL~GH~~~ 2368 (2389)
                      ...   ..+++-....+.   ...-.-.+|.+ +|....|-   --|..|..||+-.+    .|    .-+..+.-|-+.
T Consensus       353 ~k~~~~~~~~~~~~vvaevevGlGPLHTaFDg-~G~aytsl---f~dsqv~kwn~~~a~~~~~g~~~~~v~~k~dV~y~p  428 (635)
T PRK02888        353 LDDLFDGKIKPRDAVVAEPELGLGPLHTAFDG-RGNAYTTL---FLDSQIVKWNIEAAIRAYKGEKVDPIVQKLDVHYQP  428 (635)
T ss_pred             hhhhhhccCCccceEEEeeccCCCcceEEECC-CCCEEEeE---eecceeEEEehHHHHHHhccccCCcceecccCCCcc
Confidence            410   000111111110   11123477888 88866553   47889999997310    11    224445444433


Q ss_pred             EEEE-----eecccchhhhcccc
Q 000080         2369 YDLF-----LPLKLLNFALSKCR 2386 (2389)
Q Consensus      2369 V~sv-----A~~~~~~~~~s~~~ 2386 (2389)
                      -...     .-.++|.|.+|-|.
T Consensus       429 gh~~~~~g~t~~~dgk~l~~~nk  451 (635)
T PRK02888        429 GHNHASMGETKEADGKWLVSLNK  451 (635)
T ss_pred             ceeeecCCCcCCCCCCEEEEccc
Confidence            3333     34789999988764


No 316
>PF15492 Nbas_N:  Neuroblastoma-amplified sequence, N terminal
Probab=90.81  E-value=18  Score=44.61  Aligned_cols=213  Identities=15%  Similarity=0.192  Sum_probs=111.0

Q ss_pred             ccccccCCCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCCcccccccccccceeeeec-cCCCCCeeEEEEcCCCC
Q 000080           29 RSEFIPTAPTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSPLSQEEALIGPIFRQVFAL-SDNSLPVTSISWSPETP  107 (2389)
Q Consensus        29 ~~~~ip~ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~e~~~~p~~~Qvieg-h~d~~dVk~VaWSPd~~  107 (2389)
                      ....+|-.|-..=|.++|+||  + ..+|||.+++-|-.-  +-+...-++|.|--  ..++ -.  ..|..+.+-+-.-
T Consensus        34 ~kcqVpkD~~PQWRkl~WSpD--~-tlLa~a~S~G~i~vf--dl~g~~lf~I~p~~--~~~~d~~--~Aiagl~Fl~~~~  104 (282)
T PF15492_consen   34 GKCQVPKDPNPQWRKLAWSPD--C-TLLAYAESTGTIRVF--DLMGSELFVIPPAM--SFPGDLS--DAIAGLIFLEYKK  104 (282)
T ss_pred             EEEecCCCCCchheEEEECCC--C-cEEEEEcCCCeEEEE--ecccceeEEcCccc--ccCCccc--cceeeeEeecccc
Confidence            345678889999999999999  7 599999777766554  32222222322210  0111 01  2344444444210


Q ss_pred             C----CCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec----ccceEEEEeecCCCCeEEEEecc---eEEeeccCCc
Q 000080          108 S----IGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV----QGTKVEAIEWTGSGDGIVAGGME---TVLWKKKNTL  176 (2389)
Q Consensus       108 ~----~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~----hssTV~sIAWSpdG~rLaSggdD---V~IW~~~~s~  176 (2389)
                      +    .+-|+..|++.+|=|--..+.+ ..  .....++.    ...-|.++.|+|.-+.|+.||-.   ..+++ ....
T Consensus       105 s~~ws~ELlvi~Y~G~L~Sy~vs~gt~-q~--y~e~hsfsf~~~yp~Gi~~~vy~p~h~LLlVgG~~~~~~~~s~-a~~~  180 (282)
T PF15492_consen  105 SAQWSYELLVINYRGQLRSYLVSVGTN-QG--YQENHSFSFSSHYPHGINSAVYHPKHRLLLVGGCEQNQDGMSK-ASSC  180 (282)
T ss_pred             ccccceeEEEEeccceeeeEEEEcccC-Cc--ceeeEEEEecccCCCceeEEEEcCCCCEEEEeccCCCCCcccc-cccc
Confidence            0    0234468998888886421111 11  22333332    36679999999988877766654   33443 2333


Q ss_pred             EEEEEEeeccccceEE-EEeecCCCceEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCC
Q 000080          177 WEIAWKFKENYPQNLV-SATWSIEGPSATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTR  255 (2389)
Q Consensus       177 Wecvwt~~~~~~~~iv-svaWSpdG~fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~  255 (2389)
                      .-++|+.-..  .+.| .+. +-+..+.+......|.+-       +        ...+......-..-|..+.=+|   
T Consensus       181 GLtaWRiL~~--~Pyyk~v~-~~~~~~~~~~~~~~~~~~-------~--------~~~~fs~~~~~~d~i~kmSlSP---  239 (282)
T PF15492_consen  181 GLTAWRILSD--SPYYKQVT-SSEDDITASSKRRGLLRI-------P--------SFKFFSRQGQEQDGIFKMSLSP---  239 (282)
T ss_pred             CceEEEEcCC--CCcEEEcc-ccCccccccccccceeec-------c--------ceeeeeccccCCCceEEEEECC---
Confidence            4444543222  2333 232 111112111110001000       0        0000001122235678889999   


Q ss_pred             CCCCCCCccccCceEEeeecCCeEEEEEee
Q 000080          256 RHSPGDTKRSQRHVLLTCCLDGTVRLWCEM  285 (2389)
Q Consensus       256 ~~~~~Dgk~~~~nILAScSdDgTVRLW~e~  285 (2389)
                           ||+.     ||++..+|.+-||++-
T Consensus       240 -----dg~~-----La~ih~sG~lsLW~iP  259 (282)
T PF15492_consen  240 -----DGSL-----LACIHFSGSLSLWEIP  259 (282)
T ss_pred             -----CCCE-----EEEEEcCCeEEEEecC
Confidence                 7777     9999999999999954


No 317
>PF07433 DUF1513:  Protein of unknown function (DUF1513);  InterPro: IPR008311 There are currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function.
Probab=90.78  E-value=1.7  Score=53.75  Aligned_cols=143  Identities=10%  Similarity=0.049  Sum_probs=89.4

Q ss_pred             EEEEEcCC-CCeEEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-----CCcE
Q 000080         2223 RAFSSHPL-RPFFLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-----DGTV 2295 (2389)
Q Consensus      2223 rsVAFsPd-G~~LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-----DgTV 2295 (2389)
                      ..++.||+ +..++-+-.-|+ ..+||..+|+.++.+..-       +|+ ..-=--.|||||++|-+.-.     .|.|
T Consensus         8 H~~a~~p~~~~avafaRRPG~~~~v~D~~~g~~~~~~~a~-------~gR-HFyGHg~fs~dG~~LytTEnd~~~g~G~I   79 (305)
T PF07433_consen    8 HGVAAHPTRPEAVAFARRPGTFALVFDCRTGQLLQRLWAP-------PGR-HFYGHGVFSPDGRLLYTTENDYETGRGVI   79 (305)
T ss_pred             cceeeCCCCCeEEEEEeCCCcEEEEEEcCCCceeeEEcCC-------CCC-EEecCEEEcCCCCEEEEeccccCCCcEEE
Confidence            56799995 446777777666 589999999988877421       221 22223579999999988654     4899


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCC-----CCCeEEEee-C-------C-CCCCCceE-
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSS-----NGINVVVWD-T-------L-APPTSSRA- 2360 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS-----~D~TVrLWD-~-------l-~~tg~~v~- 2360 (2389)
                      -+||++.+    .+.+..+..|.-.--++.+.| ||+.|+.|= ++     +.+-.||.= +       + ..+|+.+. 
T Consensus        80 gVyd~~~~----~~ri~E~~s~GIGPHel~l~p-DG~tLvVAN-GGI~Thpd~GR~kLNl~tM~psL~~ld~~sG~ll~q  153 (305)
T PF07433_consen   80 GVYDAARG----YRRIGEFPSHGIGPHELLLMP-DGETLVVAN-GGIETHPDSGRAKLNLDTMQPSLVYLDARSGALLEQ  153 (305)
T ss_pred             EEEECcCC----cEEEeEecCCCcChhhEEEcC-CCCEEEEEc-CCCccCcccCceecChhhcCCceEEEecCCCceeee
Confidence            99999832    144555555554445788999 886666541 11     111223321 1       1 23455543 


Q ss_pred             -EE--EeecCcEEEEeecccch
Q 000080         2361 -SI--TCHEGLYDLFLPLKLLN 2379 (2389)
Q Consensus      2361 -sL--~GH~~~V~svA~~~~~~ 2379 (2389)
                       .|  .-|...++=+|...+|.
T Consensus       154 ~~Lp~~~~~lSiRHLa~~~~G~  175 (305)
T PF07433_consen  154 VELPPDLHQLSIRHLAVDGDGT  175 (305)
T ss_pred             eecCccccccceeeEEecCCCc
Confidence             35  45777787777777765


No 318
>KOG2695 consensus WD40 repeat protein [General function prediction only]
Probab=90.44  E-value=0.4  Score=59.18  Aligned_cols=118  Identities=14%  Similarity=0.146  Sum_probs=83.8

Q ss_pred             EEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceee
Q 000080         2235 LVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESC 2314 (2389)
Q Consensus      2235 ASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl 2314 (2389)
                      ++.+.+..|-|=|+++|-. +.|.           ..+.|.+.+|.--++.+-.|...|.|-.-|++.+-+-+..+... 
T Consensus       228 fs~G~sqqv~L~nvetg~~-qsf~-----------sksDVfAlQf~~s~nLv~~GcRngeI~~iDLR~rnqG~~~~a~r-  294 (425)
T KOG2695|consen  228 FSVGLSQQVLLTNVETGHQ-QSFQ-----------SKSDVFALQFAGSDNLVFNGCRNGEIFVIDLRCRNQGNGWCAQR-  294 (425)
T ss_pred             ecccccceeEEEEeecccc-cccc-----------cchhHHHHHhcccCCeeEecccCCcEEEEEeeecccCCCcceEE-
Confidence            4556777888888887743 2332           24779999999999999999999999999999852111122222 


Q ss_pred             eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc---eEEEEeecCcEE
Q 000080         2315 LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS---RASITCHEGLYD 2370 (2389)
Q Consensus      2315 ~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~---v~sL~GH~~~V~ 2370 (2389)
                      .-|...|.++..-.-+++.|.++   +.+++|+|||...  .+|   |++.+||.|.-.
T Consensus       295 lyh~Ssvtslq~Lq~s~q~LmaS---~M~gkikLyD~R~--~K~~~~V~qYeGHvN~~a  348 (425)
T KOG2695|consen  295 LYHDSSVTSLQILQFSQQKLMAS---DMTGKIKLYDLRA--TKCKKSVMQYEGHVNLSA  348 (425)
T ss_pred             EEcCcchhhhhhhccccceEeec---cCcCceeEeeehh--hhcccceeeeeccccccc
Confidence            23888888776654355666653   5899999999853  345   899999976544


No 319
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=90.31  E-value=0.33  Score=64.81  Aligned_cols=105  Identities=18%  Similarity=0.157  Sum_probs=78.9

Q ss_pred             CCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2270 ALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2270 H~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      |...-++++||-+.+.|+.|+..|.|++.++.+|     .......||+..|.-|-=+- ||.++.|.+. +.--...||
T Consensus      1100 ~~~~fTc~afs~~~~hL~vG~~~Geik~~nv~sG-----~~e~s~ncH~SavT~vePs~-dgs~~Ltsss-~S~PlsaLW 1172 (1516)
T KOG1832|consen 1100 ETALFTCIAFSGGTNHLAVGSHAGEIKIFNVSSG-----SMEESVNCHQSAVTLVEPSV-DGSTQLTSSS-SSSPLSALW 1172 (1516)
T ss_pred             cccceeeEEeecCCceEEeeeccceEEEEEccCc-----cccccccccccccccccccC-Ccceeeeecc-ccCchHHHh
Confidence            4477899999999999999999999999999997     35567789999999888888 8888877542 233368899


Q ss_pred             eCCCCCCCceEEEEeecCcEEEEeeccc-chhhhcccc
Q 000080         2350 DTLAPPTSSRASITCHEGLYDLFLPLKL-LNFALSKCR 2386 (2389)
Q Consensus      2350 D~l~~tg~~v~sL~GH~~~V~svA~~~~-~~~~~s~~~ 2386 (2389)
                      |+- .+++.++++.+-.    ++-|+.. -.+||+.|+
T Consensus      1173 ~~~-s~~~~~Hsf~ed~----~vkFsn~~q~r~~gt~~ 1205 (1516)
T KOG1832|consen 1173 DAS-STGGPRHSFDEDK----AVKFSNSLQFRALGTEA 1205 (1516)
T ss_pred             ccc-cccCccccccccc----eeehhhhHHHHHhcccc
Confidence            984 4666788886432    3444433 345666654


No 320
>COG5354 Uncharacterized protein, contains Trp-Asp (WD) repeat [General function prediction only]
Probab=89.69  E-value=3.1  Score=53.85  Aligned_cols=136  Identities=13%  Similarity=0.131  Sum_probs=92.5

Q ss_pred             EEEEcCCCCeEEEEe-----------CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--
Q 000080         2224 AFSSHPLRPFFLVGS-----------SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-- 2290 (2389)
Q Consensus      2224 sVAFsPdG~~LASGS-----------~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-- 2290 (2389)
                      .+-|++.|.+|+.=-           ...+++|.++. ++-++...          +-.+.|...+|+|++++||..+  
T Consensus       227 qLkW~~~g~~ll~l~~t~~ksnKsyfgesnLyl~~~~-e~~i~V~~----------~~~~pVhdf~W~p~S~~F~vi~g~  295 (561)
T COG5354         227 QLKWQVLGKYLLVLVMTHTKSNKSYFGESNLYLLRIT-ERSIPVEK----------DLKDPVHDFTWEPLSSRFAVISGY  295 (561)
T ss_pred             EEEEecCCceEEEEEEEeeecccceeccceEEEEeec-ccccceec----------cccccceeeeecccCCceeEEecc
Confidence            568899999765311           23567888875 44333221          1247799999999999999876  


Q ss_pred             CCCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080         2291 LDGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus      2291 ~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
                      .+-++.+.|++..    ++    +-..+..=+.+.|+| .++++..||++-.-++|.+||.. ..-.++..+.+-.  .+
T Consensus       296 ~pa~~s~~~lr~N----l~----~~~Pe~~rNT~~fsp-~~r~il~agF~nl~gni~i~~~~-~rf~~~~~~~~~n--~s  363 (561)
T COG5354         296 MPASVSVFDLRGN----LR----FYFPEQKRNTIFFSP-HERYILFAGFDNLQGNIEIFDPA-GRFKVAGAFNGLN--TS  363 (561)
T ss_pred             cccceeecccccc----eE----EecCCcccccccccC-cccEEEEecCCccccceEEeccC-CceEEEEEeecCC--ce
Confidence            7889999999742    11    122344445678999 89999999999889999999962 1112344666543  44


Q ss_pred             EEeecccchhhh
Q 000080         2371 LFLPLKLLNFAL 2382 (2389)
Q Consensus      2371 svA~~~~~~~~~ 2382 (2389)
                      -...+|+|.|..
T Consensus       364 ~~~wspd~qF~~  375 (561)
T COG5354         364 YCDWSPDGQFYD  375 (561)
T ss_pred             EeeccCCceEEE
Confidence            556778887754


No 321
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=89.61  E-value=2.3  Score=52.76  Aligned_cols=113  Identities=8%  Similarity=-0.049  Sum_probs=72.6

Q ss_pred             CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080         2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
                      +..+..++.|+.++.||..+|+.+-....        .   . ..  .+..+|+++..++.||.|..+|..+|.     .
T Consensus       241 ~~~vy~~~~~g~l~a~d~~tG~~~W~~~~--------~---~-~~--~p~~~~~~vyv~~~~G~l~~~d~~tG~-----~  301 (377)
T TIGR03300       241 GGQVYAVSYQGRVAALDLRSGRVLWKRDA--------S---S-YQ--GPAVDDNRLYVTDADGVVVALDRRSGS-----E  301 (377)
T ss_pred             CCEEEEEEcCCEEEEEECCCCcEEEeecc--------C---C-cc--CceEeCCEEEEECCCCeEEEEECCCCc-----E
Confidence            45677788999999999999987765421        0   1 11  122357778888899999999999873     2


Q ss_pred             ceeeeecCCC-eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEE
Q 000080         2311 MESCLCFSSH-AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYD 2370 (2389)
Q Consensus      2311 l~tl~gHs~~-V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~ 2370 (2389)
                      +.......+. ..+.+.   .|..|.++   +.|+.|.++|.  .+++.+.++.-|...+.
T Consensus       302 ~W~~~~~~~~~~ssp~i---~g~~l~~~---~~~G~l~~~d~--~tG~~~~~~~~~~~~~~  354 (377)
T TIGR03300       302 LWKNDELKYRQLTAPAV---VGGYLVVG---DFEGYLHWLSR--EDGSFVARLKTDGSGIA  354 (377)
T ss_pred             EEccccccCCccccCEE---ECCEEEEE---eCCCEEEEEEC--CCCCEEEEEEcCCCccc
Confidence            2222111111 112222   24566654   48899999997  56888888876665443


No 322
>PF08553 VID27:  VID27 cytoplasmic protein;  InterPro: IPR013863  This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=88.90  E-value=2.3  Score=58.33  Aligned_cols=129  Identities=11%  Similarity=0.126  Sum_probs=86.6

Q ss_pred             EEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-------CCEEEEEeCCCcEEEeeCCCCCccCc
Q 000080         2236 VGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-------GHRFASAALDGTVCTWQLEVGGRSNV 2308 (2389)
Q Consensus      2236 SGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-------G~~LASgS~DgTVkLWDl~tggrs~~ 2308 (2389)
                      .......|+--|+.+|+-+..+.+   |.      ...|.  .|.|+       ...-..|=.++.+..||.+..+.   
T Consensus       499 ~~~~~~~ly~mDLe~GKVV~eW~~---~~------~~~v~--~~~p~~K~aqlt~e~tflGls~n~lfriDpR~~~~---  564 (794)
T PF08553_consen  499 DPNNPNKLYKMDLERGKVVEEWKV---HD------DIPVV--DIAPDSKFAQLTNEQTFLGLSDNSLFRIDPRLSGN---  564 (794)
T ss_pred             cCCCCCceEEEecCCCcEEEEeec---CC------Cccee--EecccccccccCCCceEEEECCCceEEeccCCCCC---
Confidence            334677899999999999999863   21      12244  44443       22345567788999999997541   


Q ss_pred             ccceeeeecC----CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2309 RPMESCLCFS----SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2309 k~l~tl~gHs----~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      +.+. -+.|.    ..-.++|-.. +|. ||.|   |.+|-|||+|-+  ..+.-..|.|--.+|..|..+.+|+|+|--
T Consensus       565 k~v~-~~~k~Y~~~~~Fs~~aTt~-~G~-iavg---s~~G~IRLyd~~--g~~AKT~lp~lG~pI~~iDvt~DGkwilaT  636 (794)
T PF08553_consen  565 KLVD-SQSKQYSSKNNFSCFATTE-DGY-IAVG---SNKGDIRLYDRL--GKRAKTALPGLGDPIIGIDVTADGKWILAT  636 (794)
T ss_pred             ceee-ccccccccCCCceEEEecC-Cce-EEEE---eCCCcEEeeccc--chhhhhcCCCCCCCeeEEEecCCCcEEEEe
Confidence            2221 12222    2334566665 665 5554   699999999953  123345677878999999999999999999


Q ss_pred             cc
Q 000080         2385 CR 2386 (2389)
Q Consensus      2385 ~~ 2386 (2389)
                      |+
T Consensus       637 c~  638 (794)
T PF08553_consen  637 CK  638 (794)
T ss_pred             ec
Confidence            96


No 323
>PF00930 DPPIV_N:  Dipeptidyl peptidase IV (DPP IV) N-terminal region;  InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold:  Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases.   In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding.  Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis.  Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide  It is a type II membrane protein that forms a homodimer.  CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=88.37  E-value=0.82  Score=56.75  Aligned_cols=105  Identities=12%  Similarity=0.089  Sum_probs=66.9

Q ss_pred             cCCCCeEEEE---------eCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2228 HPLRPFFLVG---------SSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2228 sPdG~~LASG---------S~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      ||||++++-.         |..+.+.++|+.+++......   .        ...+....+||||+.+|-... +-|.++
T Consensus         1 S~d~~~~l~~~~~~~~~r~s~~~~y~i~d~~~~~~~~l~~---~--------~~~~~~~~~sP~g~~~~~v~~-~nly~~   68 (353)
T PF00930_consen    1 SPDGKFVLFATNYTKQWRHSFKGDYYIYDIETGEITPLTP---P--------PPKLQDAKWSPDGKYIAFVRD-NNLYLR   68 (353)
T ss_dssp             -TTSSEEEEEEEEEEESSSEEEEEEEEEETTTTEEEESS----E--------ETTBSEEEE-SSSTEEEEEET-TEEEEE
T ss_pred             CCCCCeEEEEECcEEeeeeccceeEEEEecCCCceEECcC---C--------ccccccceeecCCCeeEEEec-CceEEE
Confidence            6888877662         345789999999887554321   0        256889999999999999975 779999


Q ss_pred             eCCCCCccCcccceeeeec----------------CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2299 QLEVGGRSNVRPMESCLCF----------------SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~gH----------------s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ++.++.    ..-.|..|-                -+.-..+-||| ||+.||..-  -+++.|+.+.+
T Consensus        69 ~~~~~~----~~~lT~dg~~~i~nG~~dwvyeEEv~~~~~~~~WSp-d~~~la~~~--~d~~~v~~~~~  130 (353)
T PF00930_consen   69 DLATGQ----ETQLTTDGEPGIYNGVPDWVYEEEVFDRRSAVWWSP-DSKYLAFLR--FDEREVPEYPL  130 (353)
T ss_dssp             SSTTSE----EEESES--TTTEEESB--HHHHHHTSSSSBSEEE-T-TSSEEEEEE--EE-TTS-EEEE
T ss_pred             ECCCCC----eEEeccccceeEEcCccceeccccccccccceEECC-CCCEEEEEE--ECCcCCceEEe
Confidence            887652    111122220                01124577999 999999875  36777777765


No 324
>KOG1916 consensus Nuclear protein, contains WD40 repeats [General function prediction only]
Probab=88.35  E-value=0.3  Score=65.51  Aligned_cols=133  Identities=14%  Similarity=0.194  Sum_probs=81.8

Q ss_pred             EEEEEEcC---CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEE-----------ECCCCCEEE
Q 000080         2222 TRAFSSHP---LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQ-----------FDHYGHRFA 2287 (2389)
Q Consensus      2222 VrsVAFsP---dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVa-----------FSPDG~~LA 2287 (2389)
                      ++-|.|.|   +.-++-.|-.|++|+|-++.+... .-++          +|..+|..++           .||||+.||
T Consensus       183 ~~~V~wcp~~~~~~~ic~~~~~~~i~lL~~~ra~~-~l~r----------sHs~~~~d~a~~~~g~~~l~~lSpDGtv~a  251 (1283)
T KOG1916|consen  183 PQLVSWCPIAVNKVYICYGLKGGEIRLLNINRALR-SLFR----------SHSQRVTDMAFFAEGVLKLASLSPDGTVFA  251 (1283)
T ss_pred             cceeeecccccccceeeeccCCCceeEeeechHHH-HHHH----------hcCCCcccHHHHhhchhhheeeCCCCcEEE
Confidence            35556655   456777888999999988864432 2222          2445555543           589999999


Q ss_pred             EEeCCCcEEEeeCCCCCccCcccceeee-----------ecCCC--eeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC
Q 000080         2288 SAALDGTVCTWQLEVGGRSNVRPMESCL-----------CFSSH--AMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus      2288 SgS~DgTVkLWDl~tggrs~~k~l~tl~-----------gHs~~--V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
                      .++.||.|+.|++.-.|+-.++++..+.           ||...  +.++.|..    ++.++.  -.++-+++|..  .
T Consensus       252 ~a~~dG~v~f~Qiyi~g~~~~rclhewkphd~~p~vC~lc~~~~~~~v~i~~w~----~~Ittt--d~nre~k~w~~--a  323 (1283)
T KOG1916|consen  252 WAISDGSVGFYQIYITGKIVHRCLHEWKPHDKHPRVCWLCHKQEILVVSIGKWV----LRITTT--DVNREEKFWAE--A  323 (1283)
T ss_pred             EeecCCccceeeeeeeccccHhhhhccCCCCCCCceeeeeccccccCCccceeE----EEEecc--cCCcceeEeec--c
Confidence            9999999999998543321222222222           33322  22333332    444532  36677999997  4


Q ss_pred             CCCceEEEEeecCcEEEEeec
Q 000080         2355 PTSSRASITCHEGLYDLFLPL 2375 (2389)
Q Consensus      2355 tg~~v~sL~GH~~~V~svA~~ 2375 (2389)
                      .-+|+  |.--.+.|..|+|+
T Consensus       324 ~w~Cl--l~~~~d~v~iV~p~  342 (1283)
T KOG1916|consen  324 PWQCL--LDKLIDGVQIVGPH  342 (1283)
T ss_pred             chhhh--hhhcccceEeecCC
Confidence            55665  44455678888865


No 325
>PF12657 TFIIIC_delta:  Transcription factor IIIC subunit delta N-term;  InterPro: IPR024761  This entry represents a domain found towards the N terminus of the 90 kDa subunit of transcription factor IIIC (also known as subunit 9 in yeast []). The whole subunit is involved in RNA polymerase III-mediated transcription. It is possible that this N-terminal domain interacts with TFIIIC subunit 8 [].
Probab=87.80  E-value=3.9  Score=46.39  Aligned_cols=82  Identities=20%  Similarity=0.383  Sum_probs=51.4

Q ss_pred             eEEEEcCCCCCCCcEEEecCCeEEEE---eeC-------CC---CCCCCccceeeEEe-------------c--------
Q 000080           98 TSISWSPETPSIGQLAAASENCIFVF---AHD-------SA---SSKGSFCWSQNAIL-------------V--------  143 (2389)
Q Consensus        98 k~VaWSPd~~~~GeIaASyDntIRVw---~~d-------~~---~~kgd~~W~~~~tL-------------~--------  143 (2389)
                      -+++||+|    |+||+..++.|-|.   .|.       ..   .......|......             .        
T Consensus         8 ~~l~WS~D----g~laV~t~~~v~IL~~~~P~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~p~~~~~~~~~~~~   83 (173)
T PF12657_consen    8 NALAWSED----GQLAVATGESVHILDPQTPNSLSKSFIPRPLTLPPSSIQWPITSIRRNLFTSSEWPTESPRSMDDEEI   83 (173)
T ss_pred             cCeeECCC----CCEEEEcCCeEEEEeccCCcccccccccCCcccccccCCCccceEecCccccccCceecccccccccc
Confidence            47999998    89999999999999   433       00   00001112111110             0        


Q ss_pred             ccceEEEEeecCCCC------eEEEEecc--eEEeecc---CCcEEEEEEe
Q 000080          144 QGTKVEAIEWTGSGD------GIVAGGME--TVLWKKK---NTLWEIAWKF  183 (2389)
Q Consensus       144 hssTV~sIAWSpdG~------rLaSggdD--V~IW~~~---~s~Wecvwt~  183 (2389)
                      .++.|.+++|||.|-      .||....+  +.||...   .+.|..+.-+
T Consensus        84 s~~~vv~~aWSP~Gl~~~~rClLavLTs~~~l~l~~~~~~~~~~W~~v~dv  134 (173)
T PF12657_consen   84 SSSQVVSAAWSPSGLGPNGRCLLAVLTSNGRLSLYGPPGNPQGEWNRVADV  134 (173)
T ss_pred             ccccEEEEEECCCCCCCCCceEEEEEcCCCeEEEEecCCCccccEeeeeeh
Confidence            124899999999763      34444444  9999965   6788887654


No 326
>COG5170 CDC55 Serine/threonine protein phosphatase 2A, regulatory subunit [Signal transduction mechanisms]
Probab=87.65  E-value=2.1  Score=52.55  Aligned_cols=127  Identities=15%  Similarity=0.254  Sum_probs=82.6

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eee-EecccCCCCCCC-----CCCCCCEEEEEEC-CCC-CEEEEEeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATA-TYGVLPAANVPP-----PYALASISALQFD-HYG-HRFASAAL 2291 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~-Tl~vl~gh~~p~-----~GH~~~V~sVaFS-PDG-~~LASgS~ 2291 (2389)
                      -|.+|-|.-.|.+||+|--.|.|-+++-.... |-. -|..+++|..-.     .--...|..|.+- |.| +.|.-...
T Consensus        28 ~ItaVefd~tg~YlatGDkgGRVvlfer~~s~~ceykf~teFQshe~EFDYLkSleieEKin~I~w~~~t~r~hFLlstN  107 (460)
T COG5170          28 KITAVEFDETGLYLATGDKGGRVVLFEREKSYGCEYKFFTEFQSHELEFDYLKSLEIEEKINAIEWFDDTGRNHFLLSTN  107 (460)
T ss_pred             eeeEEEeccccceEeecCCCceEEEeecccccccchhhhhhhcccccchhhhhhccHHHHhhheeeecCCCcceEEEecC
Confidence            35899999999999999999999999965443 222 122233443100     0001236667655 444 46777789


Q ss_pred             CCcEEEeeCCCC-------------------Cc------------c------Ccccceee-eecCCCeeEEEEecCCCCE
Q 000080         2292 DGTVCTWQLEVG-------------------GR------------S------NVRPMESC-LCFSSHAMDVSYITSSGSV 2333 (2389)
Q Consensus      2292 DgTVkLWDl~tg-------------------gr------------s------~~k~l~tl-~gHs~~V~sVAFSP~DGsl 2333 (2389)
                      |.|||||-+...                   |.            +      ..+|-+-. ..|..+++++.|+. |.+.
T Consensus       108 dktiKlWKiyeknlk~va~nnls~~~~~~~~g~~~s~~~l~lprls~hd~iiaa~p~rvyaNaH~yhiNSiS~Ns-D~et  186 (460)
T COG5170         108 DKTIKLWKIYEKNLKVVAENNLSDSFHSPMGGPLTSTKELLLPRLSEHDEIIAAKPCRVYANAHPYHINSISFNS-DKET  186 (460)
T ss_pred             CceeeeeeeecccchhhhccccccccccccCCCcCCHHHhhcccccccceEEEeccceeccccceeEeeeeeecC-chhe
Confidence            999999977532                   00            0      00011111 45889999999999 8888


Q ss_pred             EEEeecCCCCCeEEEeeCC
Q 000080         2334 IAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2334 LASAG~sS~D~TVrLWD~l 2352 (2389)
                      +.||    +|=.|-||++-
T Consensus       187 ~lSa----DdLrINLWnl~  201 (460)
T COG5170         187 LLSA----DDLRINLWNLE  201 (460)
T ss_pred             eeec----cceeeeecccc
Confidence            8884    88899999974


No 327
>PRK13616 lipoprotein LpqB; Provisional
Probab=87.27  E-value=2.5  Score=56.58  Aligned_cols=102  Identities=9%  Similarity=-0.029  Sum_probs=63.0

Q ss_pred             eEEEEEEcCCCCeEEEEe------CCC--cEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC
Q 000080         2221 STRAFSSHPLRPFFLVGS------SNT--HIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD 2292 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS------~Dg--TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D 2292 (2389)
                      .+.+.+++|||+.+|.--      .|.  +|.+++.+ |.. +.+.  .       |  ...+.-.|+|||+.+++.+..
T Consensus       351 ~vsspaiSpdG~~vA~v~~~~~~~~d~~s~Lwv~~~g-g~~-~~lt--~-------g--~~~t~PsWspDG~~lw~v~dg  417 (591)
T PRK13616        351 NITSAALSRSGRQVAAVVTLGRGAPDPASSLWVGPLG-GVA-VQVL--E-------G--HSLTRPSWSLDADAVWVVVDG  417 (591)
T ss_pred             CcccceECCCCCEEEEEEeecCCCCCcceEEEEEeCC-Ccc-eeee--c-------C--CCCCCceECCCCCceEEEecC
Confidence            347889999999877655      344  45555542 322 2221  1       1  236788999999988888643


Q ss_pred             ----------CcEEEe--eCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080         2293 ----------GTVCTW--QLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus      2293 ----------gTVkLW--Dl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
                                ++=.+|  ++..+.     . ..  ...+.|.++++|| ||.+||..    .++.|.|
T Consensus       418 ~~~~~v~~~~~~gql~~~~vd~ge-----~-~~--~~~g~Issl~wSp-DG~RiA~i----~~g~v~V  472 (591)
T PRK13616        418 NTVVRVIRDPATGQLARTPVDASA-----V-AS--RVPGPISELQLSR-DGVRAAMI----IGGKVYL  472 (591)
T ss_pred             cceEEEeccCCCceEEEEeccCch-----h-hh--ccCCCcCeEEECC-CCCEEEEE----ECCEEEE
Confidence                      222344  444321     1 11  2356799999999 99999975    2455655


No 328
>KOG3617 consensus WD40 and TPR repeat-containing protein [General function prediction only]
Probab=86.98  E-value=0.78  Score=61.25  Aligned_cols=81  Identities=20%  Similarity=0.249  Sum_probs=64.9

Q ss_pred             cCCCCcCc-eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe
Q 000080         2212 DPPATVEN-ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA 2290 (2389)
Q Consensus      2212 d~~atv~n-i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS 2290 (2389)
                      +|.+.+.+ +++.+++|||..-.|++|=.-|.+.+|..++. ...|.-         .-|...+.-+.|||||+.+.|+.
T Consensus        51 EPqr~Vt~P~hatSLCWHpe~~vLa~gwe~g~~~v~~~~~~-e~htv~---------~th~a~i~~l~wS~~G~~l~t~d  120 (1416)
T KOG3617|consen   51 EPQRDVTYPVHATSLCWHPEEFVLAQGWEMGVSDVQKTNTT-ETHTVV---------ETHPAPIQGLDWSHDGTVLMTLD  120 (1416)
T ss_pred             CCCcccccceehhhhccChHHHHHhhccccceeEEEecCCc-eeeeec---------cCCCCCceeEEecCCCCeEEEcC
Confidence            35556665 67788999999999999999999999997543 344431         12568899999999999999999


Q ss_pred             CCCcEEEeeCCC
Q 000080         2291 LDGTVCTWQLEV 2302 (2389)
Q Consensus      2291 ~DgTVkLWDl~t 2302 (2389)
                      .=|.|.+|....
T Consensus       121 ~~g~v~lwr~d~  132 (1416)
T KOG3617|consen  121 NPGSVHLWRYDV  132 (1416)
T ss_pred             CCceeEEEEeee
Confidence            999999996653


No 329
>PF10647 Gmad1:  Lipoprotein LpqB beta-propeller domain;  InterPro: IPR018910  The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues. 
Probab=86.54  E-value=6.8  Score=47.09  Aligned_cols=113  Identities=14%  Similarity=0.110  Sum_probs=71.5

Q ss_pred             EEEEEEcCCCCeEEEEe---CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2222 TRAFSSHPLRPFFLVGS---SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS---~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      +.+.+.+|||+.+|.-.   ....++.+..  +.......  .+         ..+..-.|+++|...+....+...+++
T Consensus        26 ~~s~AvS~dg~~~A~v~~~~~~~~L~~~~~--~~~~~~~~--~g---------~~l~~PS~d~~g~~W~v~~~~~~~~~~   92 (253)
T PF10647_consen   26 VTSPAVSPDGSRVAAVSEGDGGRSLYVGPA--GGPVRPVL--TG---------GSLTRPSWDPDGWVWTVDDGSGGVRVV   92 (253)
T ss_pred             ccceEECCCCCeEEEEEEcCCCCEEEEEcC--CCcceeec--cC---------CccccccccCCCCEEEEEcCCCceEEE
Confidence            47779999999777655   4444555544  43333321  11         357888999999999998989999998


Q ss_pred             e-CCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2299 Q-LEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2299 D-l~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      . ..+++.   .+.. ....-...|.++++|| ||.++|-.-....++.|.+=-+
T Consensus        93 ~~~~~g~~---~~~~v~~~~~~~~I~~l~vSp-DG~RvA~v~~~~~~~~v~va~V  143 (253)
T PF10647_consen   93 RDSASGTG---EPVEVDWPGLRGRITALRVSP-DGTRVAVVVEDGGGGRVYVAGV  143 (253)
T ss_pred             EecCCCcc---eeEEecccccCCceEEEEECC-CCcEEEEEEecCCCCeEEEEEE
Confidence            5 333321   1111 1111112899999999 9999987532234566666554


No 330
>PRK13616 lipoprotein LpqB; Provisional
Probab=86.41  E-value=4  Score=54.75  Aligned_cols=144  Identities=17%  Similarity=0.057  Sum_probs=72.7

Q ss_pred             EEEEEcCCCCeEEEEeCC-CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE---e
Q 000080         2223 RAFSSHPLRPFFLVGSSN-THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT---W 2298 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~D-gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL---W 2298 (2389)
                      .+-+|+|||..|++.++. ..+++.+-.....+....+ .+..... .....|.++++||||+++|... +|.|.+   =
T Consensus       400 t~PsWspDG~~lw~v~dg~~~~~v~~~~~~gql~~~~v-d~ge~~~-~~~g~Issl~wSpDG~RiA~i~-~g~v~Va~Vv  476 (591)
T PRK13616        400 TRPSWSLDADAVWVVVDGNTVVRVIRDPATGQLARTPV-DASAVAS-RVPGPISELQLSRDGVRAAMII-GGKVYLAVVE  476 (591)
T ss_pred             CCceECCCCCceEEEecCcceEEEeccCCCceEEEEec-cCchhhh-ccCCCcCeEEECCCCCEEEEEE-CCEEEEEEEE
Confidence            344899999988887654 2344444321112221111 1110000 0124699999999999999887 466665   2


Q ss_pred             eCCCCCccCcccceeee-ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEe--ecCcEEEEeec
Q 000080         2299 QLEVGGRSNVRPMESCL-CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITC--HEGLYDLFLPL 2375 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~tl~-gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~G--H~~~V~svA~~ 2375 (2389)
                      ....|.. .+.....+. +-...+.+++|.+ +++++ .+.   .+....+|.+.. .|.....+.+  ...++..||-.
T Consensus       477 r~~~G~~-~l~~~~~l~~~l~~~~~~l~W~~-~~~L~-V~~---~~~~~~v~~v~v-DG~~~~~~~~~n~~~~v~~vaa~  549 (591)
T PRK13616        477 QTEDGQY-ALTNPREVGPGLGDTAVSLDWRT-GDSLV-VGR---SDPEHPVWYVNL-DGSNSDALPSRNLSAPVVAVAAS  549 (591)
T ss_pred             eCCCCce-eecccEEeecccCCccccceEec-CCEEE-EEe---cCCCCceEEEec-CCccccccCCCCccCceEEEecC
Confidence            3222211 011112222 2233467899998 77765 432   334455677521 2222122222  25556666655


Q ss_pred             c
Q 000080         2376 K 2376 (2389)
Q Consensus      2376 ~ 2376 (2389)
                      +
T Consensus       550 ~  550 (591)
T PRK13616        550 P  550 (591)
T ss_pred             C
Confidence            4


No 331
>TIGR03300 assembly_YfgL outer membrane assembly lipoprotein YfgL. Members of this protein family are YfgL, a lipoprotein component of a complex that acts protein insertion into the bacterial outer membrane. Other members of this complex are NlpB, YfiO, and YaeT. This protein contains multiple copies of a repeat that, in other contexts, are associated with binding of the coenzyme PQQ.
Probab=86.00  E-value=4.3  Score=50.42  Aligned_cols=98  Identities=8%  Similarity=0.017  Sum_probs=62.1

Q ss_pred             CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080         2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus      2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
                      ++..+..++.||.|..+|..+|+.+-.+..+.+         ..+.+...  .|..+..++.||.|.++|..+|+     
T Consensus       278 ~~~~vyv~~~~G~l~~~d~~tG~~~W~~~~~~~---------~~~ssp~i--~g~~l~~~~~~G~l~~~d~~tG~-----  341 (377)
T TIGR03300       278 DDNRLYVTDADGVVVALDRRSGSELWKNDELKY---------RQLTAPAV--VGGYLVVGDFEGYLHWLSREDGS-----  341 (377)
T ss_pred             eCCEEEEECCCCeEEEEECCCCcEEEccccccC---------CccccCEE--ECCEEEEEeCCCEEEEEECCCCC-----
Confidence            466777788999999999999987755421111         11122122  47799999999999999999873     


Q ss_pred             cceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2310 PMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2310 ~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      .+.++.-+...+. +-++.  ++++++.    +.|++|..+
T Consensus       342 ~~~~~~~~~~~~~~sp~~~--~~~l~v~----~~dG~l~~~  376 (377)
T TIGR03300       342 FVARLKTDGSGIASPPVVV--GDGLLVQ----TRDGDLYAF  376 (377)
T ss_pred             EEEEEEcCCCccccCCEEE--CCEEEEE----eCCceEEEe
Confidence            4445544443332 22333  4455543    378877654


No 332
>PF13360 PQQ_2:  PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=84.99  E-value=8.9  Score=43.81  Aligned_cols=141  Identities=17%  Similarity=0.113  Sum_probs=80.8

Q ss_pred             ccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEE
Q 000080         2199 LGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQ 2278 (2389)
Q Consensus      2199 ~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVa 2278 (2389)
                      +.-.+.+.+|.+.- .......  .. ...+++..+.+++.++.|+.||..+|+.+-.+.. ++.     .+..      
T Consensus         8 ~d~~tG~~~W~~~~-~~~~~~~--~~-~~~~~~~~v~~~~~~~~l~~~d~~tG~~~W~~~~-~~~-----~~~~------   71 (238)
T PF13360_consen    8 LDPRTGKELWSYDL-GPGIGGP--VA-TAVPDGGRVYVASGDGNLYALDAKTGKVLWRFDL-PGP-----ISGA------   71 (238)
T ss_dssp             EETTTTEEEEEEEC-SSSCSSE--EE-TEEEETTEEEEEETTSEEEEEETTTSEEEEEEEC-SSC-----GGSG------
T ss_pred             EECCCCCEEEEEEC-CCCCCCc--cc-eEEEeCCEEEEEcCCCEEEEEECCCCCEEEEeec-ccc-----ccce------
Confidence            35556677776621 1112222  11 1333566677779999999999999998877642 221     0111      


Q ss_pred             ECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee-eeecC---CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCC
Q 000080         2279 FDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES-CLCFS---SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAP 2354 (2389)
Q Consensus      2279 FSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t-l~gHs---~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~ 2354 (2389)
                      ...++..+..++.|+.|..+|.++|.     .+.. .....   ......+... +|..++.+   ..++.|...|.  .
T Consensus        72 ~~~~~~~v~v~~~~~~l~~~d~~tG~-----~~W~~~~~~~~~~~~~~~~~~~~-~~~~~~~~---~~~g~l~~~d~--~  140 (238)
T PF13360_consen   72 PVVDGGRVYVGTSDGSLYALDAKTGK-----VLWSIYLTSSPPAGVRSSSSPAV-DGDRLYVG---TSSGKLVALDP--K  140 (238)
T ss_dssp             EEEETTEEEEEETTSEEEEEETTTSC-----EEEEEEE-SSCTCSTB--SEEEE-ETTEEEEE---ETCSEEEEEET--T
T ss_pred             eeecccccccccceeeeEecccCCcc-----eeeeeccccccccccccccCceE-ecCEEEEE---eccCcEEEEec--C
Confidence            23456677777788999999999973     3333 12111   1112222333 34555544   25788999996  4


Q ss_pred             CCCceEEEEeec
Q 000080         2355 PTSSRASITCHE 2366 (2389)
Q Consensus      2355 tg~~v~sL~GH~ 2366 (2389)
                      +|+.+.....+.
T Consensus       141 tG~~~w~~~~~~  152 (238)
T PF13360_consen  141 TGKLLWKYPVGE  152 (238)
T ss_dssp             TTEEEEEEESST
T ss_pred             CCcEEEEeecCC
Confidence            666666665544


No 333
>KOG1832 consensus HIV-1 Vpr-binding protein [Cell cycle control, cell division, chromosome partitioning]
Probab=84.93  E-value=0.7  Score=61.94  Aligned_cols=135  Identities=13%  Similarity=0.105  Sum_probs=88.0

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CC-cEEEeeC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DG-TVCTWQL 2300 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-Dg-TVkLWDl 2300 (2389)
                      ..++|+-+-+.|+.|+..|.|+++++.+|.....+.          +|.+.|+-|.-|-||.+..+.|. .. -..||++
T Consensus      1105 Tc~afs~~~~hL~vG~~~Geik~~nv~sG~~e~s~n----------cH~SavT~vePs~dgs~~Ltsss~S~PlsaLW~~ 1174 (1516)
T KOG1832|consen 1105 TCIAFSGGTNHLAVGSHAGEIKIFNVSSGSMEESVN----------CHQSAVTLVEPSVDGSTQLTSSSSSSPLSALWDA 1174 (1516)
T ss_pred             eeEEeecCCceEEeeeccceEEEEEccCcccccccc----------ccccccccccccCCcceeeeeccccCchHHHhcc
Confidence            678999999999999999999999999998665542          46688999999999976655443 33 5789999


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeec---CcEEEEeecc
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHE---GLYDLFLPLK 2376 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~---~~V~svA~~~ 2376 (2389)
                      ...+    .+..++.    .-..|-|+. .-+.=| -|.  ....+-|+|+  +++..+++ |.+-.   -.-++..|+|
T Consensus      1175 ~s~~----~~~Hsf~----ed~~vkFsn-~~q~r~-~gt--~~d~a~~YDv--qT~~~l~tylt~~~~~~y~~n~a~FsP 1240 (1516)
T KOG1832|consen 1175 SSTG----GPRHSFD----EDKAVKFSN-SLQFRA-LGT--EADDALLYDV--QTCSPLQTYLTDTVTSSYSNNLAHFSP 1240 (1516)
T ss_pred             cccc----Ccccccc----ccceeehhh-hHHHHH-hcc--cccceEEEec--ccCcHHHHhcCcchhhhhhccccccCC
Confidence            7643    3433332    233577886 322222 232  3345789998  55554555 33211   1113555666


Q ss_pred             cchhh
Q 000080         2377 LLNFA 2381 (2389)
Q Consensus      2377 ~~~~~ 2381 (2389)
                      .-.-+
T Consensus      1241 ~D~LI 1245 (1516)
T KOG1832|consen 1241 CDTLI 1245 (1516)
T ss_pred             CcceE
Confidence            54443


No 334
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=84.40  E-value=2.4  Score=50.63  Aligned_cols=105  Identities=11%  Similarity=0.129  Sum_probs=64.6

Q ss_pred             CeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccc
Q 000080         2232 PFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPM 2311 (2389)
Q Consensus      2232 ~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l 2311 (2389)
                      .-++.|+.||.|++|++.---......        ..+-..-+..|.---++...-+++.||.||.|++.-..     .+
T Consensus        71 ~~~~vG~~dg~v~~~n~n~~g~~~d~~--------~s~~e~i~~~Ip~~~~~~~~c~~~~dg~ir~~n~~p~k-----~~  137 (238)
T KOG2444|consen   71 AKLMVGTSDGAVYVFNWNLEGAHSDRV--------CSGEESIDLGIPNGRDSSLGCVGAQDGRIRACNIKPNK-----VL  137 (238)
T ss_pred             ceEEeecccceEEEecCCccchHHHhh--------hcccccceeccccccccceeEEeccCCceeeeccccCc-----ee
Confidence            457889999999999986111111100        01112234445555677789999999999999997642     22


Q ss_pred             eeeeecC-CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2312 ESCLCFS-SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2312 ~tl~gHs-~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ...-.|+ -.+.....+. +++.|+.+- -|.|++++.|++
T Consensus       138 g~~g~h~~~~~e~~ivv~-sd~~i~~a~-~S~d~~~k~W~v  176 (238)
T KOG2444|consen  138 GYVGQHNFESGEELIVVG-SDEFLKIAD-TSHDRVLKKWNV  176 (238)
T ss_pred             eeeccccCCCcceeEEec-CCceEEeec-cccchhhhhcch
Confidence            2223344 3444555555 667777652 246778888886


No 335
>PF02897 Peptidase_S9_N:  Prolyl oligopeptidase, N-terminal beta-propeller domain;  InterPro: IPR004106 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold:  Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases.   In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding.  Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This entry represents the beta-propeller domain found at the N-terminal of prolyl oligopeptidase, including acylamino-acid-releasing enzyme (also known as acylaminoacyl peptidase), which belong to the MEROPS peptidase family S9 (clan SC), subfamily S9A. The prolyl oligopeptidase family consist of a number of evolutionary related peptidases whose catalytic activity seems to be provided by a charge relay system similar to that of the trypsin family of serine proteases, but which evolved by independent convergent evolution. The N-terminal domain of prolyl oligopeptidases form an unusual 7-bladed beta-propeller consisting of seven 4-stranded beta-sheet motifs.  Prolyl oligopeptidase is a large cytosolic enzyme involved in the maturation and degradation of peptide hormones and neuropeptides, which relate to the induction of amnesia. The enzyme contains a peptidase domain, where its catalytic triad (Ser554, His680, Asp641) is covered by the central tunnel of the N-terminal beta-propeller domain. In this way, large structured peptides are excluded from the active site, thereby protecting larger peptides and proteins from proteolysis in the cytosol []. The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. Mammalian acylaminoacyl peptidase is an exopeptidase that is a member of the same prolyl oligopeptidase family of serine peptidases. This enzyme removes acylated amino acid residues from the N terminus of oligopeptides [].; GO: 0004252 serine-type endopeptidase activity, 0006508 proteolysis; PDB: 2BKL_B 3DDU_A 1YR2_A 2XE4_A 1VZ3_A 3EQ9_A 1O6F_A 3EQ7_A 4AN0_A 1UOP_A ....
Probab=82.95  E-value=7.1  Score=49.21  Aligned_cols=102  Identities=14%  Similarity=0.088  Sum_probs=61.7

Q ss_pred             CEEEEEECCCCCEEEEE-eCC----CcEEEeeCCCCCccCcccce-eeeecCCCeeEEEEecCCCCEEEEeecCCC----
Q 000080         2273 SISALQFDHYGHRFASA-ALD----GTVCTWQLEVGGRSNVRPME-SCLCFSSHAMDVSYITSSGSVIAAAGHSSN---- 2342 (2389)
Q Consensus      2273 ~V~sVaFSPDG~~LASg-S~D----gTVkLWDl~tggrs~~k~l~-tl~gHs~~V~sVAFSP~DGslLASAG~sS~---- 2342 (2389)
                      .+...++||||+++|-+ +..    .+|++.|+++|.     .+. .+.. .. ...++|.+ ||+.+.-..+...    
T Consensus       125 ~~~~~~~Spdg~~la~~~s~~G~e~~~l~v~Dl~tg~-----~l~d~i~~-~~-~~~~~W~~-d~~~~~y~~~~~~~~~~  196 (414)
T PF02897_consen  125 SLGGFSVSPDGKRLAYSLSDGGSEWYTLRVFDLETGK-----FLPDGIEN-PK-FSSVSWSD-DGKGFFYTRFDEDQRTS  196 (414)
T ss_dssp             EEEEEEETTTSSEEEEEEEETTSSEEEEEEEETTTTE-----EEEEEEEE-EE-SEEEEECT-TSSEEEEEECSTTTSS-
T ss_pred             EeeeeeECCCCCEEEEEecCCCCceEEEEEEECCCCc-----CcCCcccc-cc-cceEEEeC-CCCEEEEEEeCcccccc
Confidence            34568999999999854 333    459999999972     222 1111 11 12399999 7777655444332    


Q ss_pred             ----CCeEEEeeCCCCCCCceEEEEeecCc--EEEEeecccchhhh
Q 000080         2343 ----GINVVVWDTLAPPTSSRASITCHEGL--YDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2343 ----D~TVrLWD~l~~tg~~v~sL~GH~~~--V~svA~~~~~~~~~ 2382 (2389)
                          ...|+.|++-.+..+..-.+++..+.  ...+..+++|+|++
T Consensus       197 ~~~~~~~v~~~~~gt~~~~d~lvfe~~~~~~~~~~~~~s~d~~~l~  242 (414)
T PF02897_consen  197 DSGYPRQVYRHKLGTPQSEDELVFEEPDEPFWFVSVSRSKDGRYLF  242 (414)
T ss_dssp             CCGCCEEEEEEETTS-GGG-EEEEC-TTCTTSEEEEEE-TTSSEEE
T ss_pred             cCCCCcEEEEEECCCChHhCeeEEeecCCCcEEEEEEecCcccEEE
Confidence                44588888732222223455555544  45888999999876


No 336
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=82.93  E-value=8.8  Score=51.59  Aligned_cols=140  Identities=14%  Similarity=0.122  Sum_probs=95.6

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .|.--++..++.+|+-|++-|.++|++-..|+. +.+.. .       |..+.+.....|++....|.|+..|.|.+.++
T Consensus        35 ~v~lTc~dst~~~l~~GsS~G~lyl~~R~~~~~-~~~~~-~-------~~~~~~~~~~vs~~e~lvAagt~~g~V~v~ql  105 (726)
T KOG3621|consen   35 RVKLTCVDATEEYLAMGSSAGSVYLYNRHTGEM-RKLKN-E-------GATGITCVRSVSSVEYLVAAGTASGRVSVFQL  105 (726)
T ss_pred             eEEEEEeecCCceEEEecccceEEEEecCchhh-hcccc-c-------CccceEEEEEecchhHhhhhhcCCceEEeehh
Confidence            445557888999999999999999999765553 33321 1       12255677888999999999999999999999


Q ss_pred             CCCCccCcccc-ee--e-eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCC-CCCCc-eEEEEeecCcEEEEee
Q 000080         2301 EVGGRSNVRPM-ES--C-LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLA-PPTSS-RASITCHEGLYDLFLP 2374 (2389)
Q Consensus      2301 ~tggrs~~k~l-~t--l-~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~-~tg~~-v~sL~GH~~~V~svA~ 2374 (2389)
                      +.+.   +.+. +.  . .-|...|++++|++ ||..+-+|   -.-|+|.+=.+.. .-..+ +|.+..-...|.-+..
T Consensus       106 ~~~~---p~~~~~~t~~d~~~~~rVTal~Ws~-~~~k~ysG---D~~Gkv~~~~L~s~~~~~~~~q~il~~ds~IVQlD~  178 (726)
T KOG3621|consen  106 NKEL---PRDLDYVTPCDKSHKCRVTALEWSK-NGMKLYSG---DSQGKVVLTELDSRQAFLSKSQEILSEDSEIVQLDY  178 (726)
T ss_pred             hccC---CCcceeeccccccCCceEEEEEecc-cccEEeec---CCCceEEEEEechhhhhccccceeeccCcceEEeec
Confidence            8742   1111 11  1 12678899999999 99999985   2456777666532 11122 4555555666666655


Q ss_pred             cc
Q 000080         2375 LK 2376 (2389)
Q Consensus      2375 ~~ 2376 (2389)
                      ..
T Consensus       179 ~q  180 (726)
T KOG3621|consen  179 LQ  180 (726)
T ss_pred             cc
Confidence            44


No 337
>COG0823 TolB Periplasmic component of the Tol biopolymer transport system [Intracellular trafficking and secretion]
Probab=82.69  E-value=6.8  Score=50.75  Aligned_cols=139  Identities=15%  Similarity=0.177  Sum_probs=74.8

Q ss_pred             cceeecCCCCCCeEEEEecCC--cEEEEeCCCCcccccccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEe--cC
Q 000080           42 STIDWLPDFAGYSWVAYGASS--LLVISHFPSPLSQEEALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAA--SE  117 (2389)
Q Consensus        42 ~ai~wlpD~~G~~~vAYasg~--~vVI~~l~SP~~~~e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaAS--yD  117 (2389)
                      ....|+||...+..+.+..+.  .+++..+..+...  .+      ..++++     .-.-+||||   +..||-+  -|
T Consensus       196 ~~p~ws~~~~~~~y~~f~~~~~~~i~~~~l~~g~~~--~i------~~~~g~-----~~~P~fspD---G~~l~f~~~rd  259 (425)
T COG0823         196 LTPAWSPDGKKLAYVSFELGGCPRIYYLDLNTGKRP--VI------LNFNGN-----NGAPAFSPD---GSKLAFSSSRD  259 (425)
T ss_pred             eccccCcCCCceEEEEEecCCCceEEEEeccCCccc--ee------eccCCc-----cCCccCCCC---CCEEEEEECCC
Confidence            346789983333233333444  3555544332211  11      113343     335689999   6666633  46


Q ss_pred             CeEEEEeeCCCCCCCCccceeeEEecc-cceEEEEeecCCCCeEEEEecc---eEEeec--cCCcEEEEEEeeccccceE
Q 000080          118 NCIFVFAHDSASSKGSFCWSQNAILVQ-GTKVEAIEWTGSGDGIVAGGME---TVLWKK--KNTLWEIAWKFKENYPQNL  191 (2389)
Q Consensus       118 ntIRVw~~d~~~~kgd~~W~~~~tL~h-ssTV~sIAWSpdG~rLaSggdD---V~IW~~--~~s~Wecvwt~~~~~~~~i  191 (2389)
                      +...||--|-  ....     ...|++ .+.=..=+|+|||++|+-.+|.   -+||..  ..+.=+.+. ..+....  
T Consensus       260 g~~~iy~~dl--~~~~-----~~~Lt~~~gi~~~Ps~spdG~~ivf~Sdr~G~p~I~~~~~~g~~~~riT-~~~~~~~--  329 (425)
T COG0823         260 GSPDIYLMDL--DGKN-----LPRLTNGFGINTSPSWSPDGSKIVFTSDRGGRPQIYLYDLEGSQVTRLT-FSGGGNS--  329 (425)
T ss_pred             CCccEEEEcC--CCCc-----ceecccCCccccCccCCCCCCEEEEEeCCCCCcceEEECCCCCceeEee-ccCCCCc--
Confidence            8888887761  1111     111443 2222367899999999988885   556653  222223331 2222211  


Q ss_pred             EEEeecCCCc-eEeeec
Q 000080          192 VSATWSIEGP-SATAAS  207 (2389)
Q Consensus       192 vsvaWSpdG~-fATag~  207 (2389)
                       .-.|||||. +|-++.
T Consensus       330 -~p~~SpdG~~i~~~~~  345 (425)
T COG0823         330 -NPVWSPDGDKIVFESS  345 (425)
T ss_pred             -CccCCCCCCEEEEEec
Confidence             348999999 777763


No 338
>PF13360 PQQ_2:  PQQ-like domain; PDB: 3HXJ_B 1YIQ_A 1KV9_A 3Q54_A 2YH3_A 3PRW_A 3P1L_A 3Q7M_A 3Q7O_A 3Q7N_A ....
Probab=82.47  E-value=7  Score=44.65  Aligned_cols=102  Identities=14%  Similarity=0.065  Sum_probs=61.8

Q ss_pred             CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecC
Q 000080         2239 SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFS 2318 (2389)
Q Consensus      2239 ~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs 2318 (2389)
                      +||+|+.||..+|+.+-.+.. ..      +. ...... ..++++.+.+++.++.|..||..+|.     .+.+... .
T Consensus         1 ~~g~l~~~d~~tG~~~W~~~~-~~------~~-~~~~~~-~~~~~~~v~~~~~~~~l~~~d~~tG~-----~~W~~~~-~   65 (238)
T PF13360_consen    1 DDGTLSALDPRTGKELWSYDL-GP------GI-GGPVAT-AVPDGGRVYVASGDGNLYALDAKTGK-----VLWRFDL-P   65 (238)
T ss_dssp             -TSEEEEEETTTTEEEEEEEC-SS------SC-SSEEET-EEEETTEEEEEETTSEEEEEETTTSE-----EEEEEEC-S
T ss_pred             CCCEEEEEECCCCCEEEEEEC-CC------CC-CCccce-EEEeCCEEEEEcCCCEEEEEECCCCC-----EEEEeec-c
Confidence            589999999999999877641 10      01 112211 44466677777999999999999972     3333332 2


Q ss_pred             CCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE
Q 000080         2319 SHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI 2362 (2389)
Q Consensus      2319 ~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL 2362 (2389)
                      ..+....... ++.+++.    +.|+.|..+|+  .+|+.+...
T Consensus        66 ~~~~~~~~~~-~~~v~v~----~~~~~l~~~d~--~tG~~~W~~  102 (238)
T PF13360_consen   66 GPISGAPVVD-GGRVYVG----TSDGSLYALDA--KTGKVLWSI  102 (238)
T ss_dssp             SCGGSGEEEE-TTEEEEE----ETTSEEEEEET--TTSCEEEEE
T ss_pred             ccccceeeec-ccccccc----cceeeeEeccc--CCcceeeee
Confidence            2211111222 4455443    25678999996  577777663


No 339
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=82.22  E-value=27  Score=44.46  Aligned_cols=140  Identities=15%  Similarity=0.116  Sum_probs=86.5

Q ss_pred             EEEEEcCCCCe-EEEEe--CCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEE-eCCCcEEEe
Q 000080         2223 RAFSSHPLRPF-FLVGS--SNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASA-ALDGTVCTW 2298 (2389)
Q Consensus      2223 rsVAFsPdG~~-LASGS--~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASg-S~DgTVkLW 2298 (2389)
                      ..++++|+++. .++-+  .+++|.+-|-.+++.+.+..   .      |- .. ..++|+|+|+++..+ +.+++|.+-
T Consensus       119 ~~~~~~~~~~~vYV~n~~~~~~~vsvid~~t~~~~~~~~---v------G~-~P-~~~a~~p~g~~vyv~~~~~~~v~vi  187 (381)
T COG3391         119 VGLAVDPDGKYVYVANAGNGNNTVSVIDAATNKVTATIP---V------GN-TP-TGVAVDPDGNKVYVTNSDDNTVSVI  187 (381)
T ss_pred             ceEEECCCCCEEEEEecccCCceEEEEeCCCCeEEEEEe---c------CC-Cc-ceEEECCCCCeEEEEecCCCeEEEE
Confidence            56799999964 44444  37999999988888877742   1      11 22 889999999855554 589999999


Q ss_pred             eCCCCCccCcccce-----eeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-EEeecCcEEEE
Q 000080         2299 QLEVGGRSNVRPME-----SCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-ITCHEGLYDLF 2372 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~-----tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-L~GH~~~V~sv 2372 (2389)
                      |.++..     ..+     ...-+ ..-..+++.| ||+.+-.+-..+.|++|-.=|+  .++..... +..-.++-..+
T Consensus       188 ~~~~~~-----v~~~~~~~~~~~~-~~P~~i~v~~-~g~~~yV~~~~~~~~~v~~id~--~~~~v~~~~~~~~~~~~~~v  258 (381)
T COG3391         188 DTSGNS-----VVRGSVGSLVGVG-TGPAGIAVDP-DGNRVYVANDGSGSNNVLKIDT--ATGNVTATDLPVGSGAPRGV  258 (381)
T ss_pred             eCCCcc-----eeccccccccccC-CCCceEEECC-CCCEEEEEeccCCCceEEEEeC--CCceEEEeccccccCCCCce
Confidence            976531     111     11112 2335688999 8884443322334467888886  23333222 22112134467


Q ss_pred             eecccchhhh
Q 000080         2373 LPLKLLNFAL 2382 (2389)
Q Consensus      2373 A~~~~~~~~~ 2382 (2389)
                      +..|+|.++-
T Consensus       259 ~~~p~g~~~y  268 (381)
T COG3391         259 AVDPAGKAAY  268 (381)
T ss_pred             eECCCCCEEE
Confidence            8888887763


No 340
>PRK02888 nitrous-oxide reductase; Validated
Probab=81.03  E-value=11  Score=50.93  Aligned_cols=56  Identities=14%  Similarity=0.114  Sum_probs=37.5

Q ss_pred             CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2292 DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2292 DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +++|.+.|.++..+.. ..+...-.=......|+++| ||+++..+|  -.+.+|-|-|+
T Consensus       295 gn~V~VID~~t~~~~~-~~v~~yIPVGKsPHGV~vSP-DGkylyVan--klS~tVSVIDv  350 (635)
T PRK02888        295 GSKVPVVDGRKAANAG-SALTRYVPVPKNPHGVNTSP-DGKYFIANG--KLSPTVTVIDV  350 (635)
T ss_pred             CCEEEEEECCccccCC-cceEEEEECCCCccceEECC-CCCEEEEeC--CCCCcEEEEEC
Confidence            4679999988710000 11222222345567799999 999988876  57889999998


No 341
>PF12234 Rav1p_C:  RAVE protein 1 C terminal;  InterPro: IPR022033  This domain family is found in eukaryotes, and is typically between 621 and 644 amino acids in length. This family is the C-terminal region of the protein RAVE (regulator of the ATPase of vacuolar and endosomal membranes). Rav1p is involved in regulating the glucose dependent assembly and disassembly of vacuolar ATPase V1 and V0 subunits. 
Probab=80.54  E-value=9.5  Score=51.54  Aligned_cols=25  Identities=8%  Similarity=-0.015  Sum_probs=14.9

Q ss_pred             CChhHHHHHHHHhCC-hhHHHHHHhc
Q 000080         1386 GDYWLTSLLEWELGN-YSQSFLTMLG 1410 (2389)
Q Consensus      1386 gDrwL~S~a~W~L~~-~~~Av~~Ll~ 1410 (2389)
                      ..||.-..+|.+|++ ...||+++++
T Consensus       465 k~Ry~~AAaFFLLag~l~dAv~V~~~  490 (631)
T PF12234_consen  465 KHRYEYAAAFFLLAGSLKDAVNVCLR  490 (631)
T ss_pred             cccHHHHHHHHHhcccHHHHHHHHHH
Confidence            456666666666654 5566666663


No 342
>PRK10115 protease 2; Provisional
Probab=80.20  E-value=35  Score=46.89  Aligned_cols=117  Identities=9%  Similarity=-0.002  Sum_probs=70.9

Q ss_pred             eeEEEEEEcCCCCeEEE-----EeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC--
Q 000080         2220 ISTRAFSSHPLRPFFLV-----GSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-- 2292 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LAS-----GS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-- 2292 (2389)
                      ..+..+.++|||++||-     |++..+|++-|+.+|+.+.+.  +       .   +.-..++|++||+.|.-+..|  
T Consensus       127 ~~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~~l~~~--i-------~---~~~~~~~w~~D~~~~~y~~~~~~  194 (686)
T PRK10115        127 YTLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGNWYPEL--L-------D---NVEPSFVWANDSWTFYYVRKHPV  194 (686)
T ss_pred             EEEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCCCCCcc--c-------c---CcceEEEEeeCCCEEEEEEecCC
Confidence            45577899999998775     445567899999888643321  1       0   111569999999877766553  


Q ss_pred             ----CcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2293 ----GTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2293 ----gTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                          ..|.+|++.++. +....+..  +......-..+.+.||+.+.....+..++.+.+++.
T Consensus       195 ~~~~~~v~~h~lgt~~-~~d~lv~~--e~~~~~~~~~~~s~d~~~l~i~~~~~~~~~~~l~~~  254 (686)
T PRK10115        195 TLLPYQVWRHTIGTPA-SQDELVYE--EKDDTFYVSLHKTTSKHYVVIHLASATTSEVLLLDA  254 (686)
T ss_pred             CCCCCEEEEEECCCCh-hHCeEEEe--eCCCCEEEEEEEcCCCCEEEEEEECCccccEEEEEC
Confidence                357778888762 11122322  222222312233337776655544556778999995


No 343
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=80.16  E-value=5.2  Score=54.76  Aligned_cols=102  Identities=16%  Similarity=0.178  Sum_probs=79.5

Q ss_pred             CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080         2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus      2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
                      ++..++-|+.-..+--.|+.+++..++..+ .         .+.|.-+  -.+++.|-+|+.-|+|-|=|.++-     +
T Consensus       146 ~~~~~i~Gg~Q~~li~~Dl~~~~e~r~~~v-~---------a~~v~im--R~Nnr~lf~G~t~G~V~LrD~~s~-----~  208 (1118)
T KOG1275|consen  146 GPSTLIMGGLQEKLIHIDLNTEKETRTTNV-S---------ASGVTIM--RYNNRNLFCGDTRGTVFLRDPNSF-----E  208 (1118)
T ss_pred             CCcceeecchhhheeeeecccceeeeeeec-c---------CCceEEE--EecCcEEEeecccceEEeecCCcC-----c
Confidence            455677788777888899999998887643 1         1224433  357889999999999999999874     6


Q ss_pred             cceeeeecCCCeeEEEEecCCCCEEEEeecCC------CCCeEEEeeC
Q 000080         2310 PMESCLCFSSHAMDVSYITSSGSVIAAAGHSS------NGINVVVWDT 2351 (2389)
Q Consensus      2310 ~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS------~D~TVrLWD~ 2351 (2389)
                      ++.++.+|++.+.++..   .|++|+|.|+|.      .|.-|++||+
T Consensus       209 ~iht~~aHs~siSDfDv---~GNlLitCG~S~R~~~l~~D~FvkVYDL  253 (1118)
T KOG1275|consen  209 TIHTFDAHSGSISDFDV---QGNLLITCGYSMRRYNLAMDPFVKVYDL  253 (1118)
T ss_pred             eeeeeeccccceeeeec---cCCeEEEeecccccccccccchhhhhhh
Confidence            88999999999986554   468999999865      4667999996


No 344
>KOG1275 consensus PAB-dependent poly(A) ribonuclease, subunit PAN2 [Replication, recombination and repair]
Probab=79.92  E-value=6.6  Score=53.82  Aligned_cols=104  Identities=19%  Similarity=0.215  Sum_probs=73.1

Q ss_pred             EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe---------CCCcEEE
Q 000080         2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA---------LDGTVCT 2297 (2389)
Q Consensus      2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS---------~DgTVkL 2297 (2389)
                      .-.+++++.+|..-|+|-|-|..+-+-+.++.   +       |++.|.  .|+=.|+.|+|++         .|.-|++
T Consensus       183 mR~Nnr~lf~G~t~G~V~LrD~~s~~~iht~~---a-------Hs~siS--DfDv~GNlLitCG~S~R~~~l~~D~FvkV  250 (1118)
T KOG1275|consen  183 MRYNNRNLFCGDTRGTVFLRDPNSFETIHTFD---A-------HSGSIS--DFDVQGNLLITCGYSMRRYNLAMDPFVKV  250 (1118)
T ss_pred             EEecCcEEEeecccceEEeecCCcCceeeeee---c-------ccccee--eeeccCCeEEEeecccccccccccchhhh
Confidence            34578999999999999999999888888884   3       556664  5888999999988         4788999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ||++.- | .+.|+   +-|-++ .-+.|.|.=-+++|.+   |.-|...+=|+
T Consensus       251 YDLRmm-r-al~PI---~~~~~P-~flrf~Psl~t~~~V~---S~sGq~q~vd~  295 (1118)
T KOG1275|consen  251 YDLRMM-R-ALSPI---QFPYGP-QFLRFHPSLTTRLAVT---SQSGQFQFVDT  295 (1118)
T ss_pred             hhhhhh-h-ccCCc---ccccCc-hhhhhcccccceEEEE---ecccceeeccc
Confidence            999986 2 22333   222222 2356777544555554   34566777774


No 345
>KOG2066 consensus Vacuolar assembly/sorting protein VPS41 [Intracellular trafficking, secretion, and vesicular transport]
Probab=78.86  E-value=12  Score=51.09  Aligned_cols=98  Identities=17%  Similarity=0.237  Sum_probs=68.0

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .+.++|  +++|+=|..+|.|++.+. +|.....+    .       |+..      .-+|..+||+|.||+|-+=-+-+
T Consensus        43 s~~av~--~~~~~~GtH~g~v~~~~~-~~~~~~~~----~-------~s~~------~~~Gey~asCS~DGkv~I~sl~~  102 (846)
T KOG2066|consen   43 SCCAVH--DKFFALGTHRGAVYLTTC-QGNPKTNF----D-------HSSS------ILEGEYVASCSDDGKVVIGSLFT  102 (846)
T ss_pred             HHHHhh--cceeeeccccceEEEEec-CCcccccc----c-------cccc------ccCCceEEEecCCCcEEEeeccC
Confidence            344444  678999999999999997 56552223    2       2232      77899999999999999988877


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecC----CCCEEEEeecCCCCCeEEEee
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITS----SGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~----DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      +.     ...+ ..+...+.+|+++|+    ..+..++||   .-| +.|..
T Consensus       103 ~~-----~~~~-~df~rpiksial~Pd~~~~~sk~fv~GG---~ag-lvL~e  144 (846)
T KOG2066|consen  103 DD-----EITQ-YDFKRPIKSIALHPDFSRQQSKQFVSGG---MAG-LVLSE  144 (846)
T ss_pred             Cc-----ccee-EecCCcceeEEeccchhhhhhhheeecC---cce-EEEeh
Confidence            52     2222 235678899999995    245566764   333 77765


No 346
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=78.77  E-value=8.8  Score=50.29  Aligned_cols=135  Identities=11%  Similarity=0.131  Sum_probs=93.3

Q ss_pred             CCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCC--EEE-----EEeCCCcEEEeeCC
Q 000080         2230 LRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGH--RFA-----SAALDGTVCTWQLE 2301 (2389)
Q Consensus      2230 dG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~--~LA-----SgS~DgTVkLWDl~ 2301 (2389)
                      +.+ +|.+|..-..++-=|+++|+-+.++..          | ..|.-|.|.||++  .+.     .|=.|+.|.-||.+
T Consensus       344 dsnlil~~~~~~~~l~klDIE~GKIVeEWk~----------~-~di~mv~~t~d~K~~Ql~~e~TlvGLs~n~vfriDpR  412 (644)
T KOG2395|consen  344 DSNLILMDGGEQDKLYKLDIERGKIVEEWKF----------E-DDINMVDITPDFKFAQLTSEQTLVGLSDNSVFRIDPR  412 (644)
T ss_pred             ccceEeeCCCCcCcceeeecccceeeeEeec----------c-CCcceeeccCCcchhcccccccEEeecCCceEEeccc
Confidence            344 455677777889999999999988862          2 3489999999974  333     34568999999999


Q ss_pred             CCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCc-eEEEEeecCcEEEEeecc
Q 000080         2302 VGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSS-RASITCHEGLYDLFLPLK 2376 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~-v~sL~GH~~~V~svA~~~ 2376 (2389)
                      ..+.   ..+.--++|..    .-.+++--. +|. ||.|   |.+|.|||+|-   .+.. -..|.|--..|.-|..+-
T Consensus       413 v~~~---~kl~~~q~kqy~~k~nFsc~aTT~-sG~-Ivvg---S~~GdIRLYdr---i~~~AKTAlPgLG~~I~hVdvta  481 (644)
T KOG2395|consen  413 VQGK---NKLAVVQSKQYSTKNNFSCFATTE-SGY-IVVG---SLKGDIRLYDR---IGRRAKTALPGLGDAIKHVDVTA  481 (644)
T ss_pred             ccCc---ceeeeeeccccccccccceeeecC-Cce-EEEe---ecCCcEEeehh---hhhhhhhcccccCCceeeEEeec
Confidence            7542   12233344442    112333333 555 5544   69999999995   2333 346788888999999999


Q ss_pred             cchhhhcccc
Q 000080         2377 LLNFALSKCR 2386 (2389)
Q Consensus      2377 ~~~~~~s~~~ 2386 (2389)
                      +|.|+|-.|.
T Consensus       482 dGKwil~Tc~  491 (644)
T KOG2395|consen  482 DGKWILATCK  491 (644)
T ss_pred             cCcEEEEecc
Confidence            9999998886


No 347
>PF07995 GSDH:  Glucose / Sorbosone dehydrogenase;  InterPro: IPR012938 Proteins containing this domain are thought to be glucose/sorbosone dehydrogenases. The best characterised of these proteins is soluble glucose dehydrogenase (P13650 from SWISSPROT) from Acinetobacter calcoaceticus, which oxidises glucose to gluconolactone. The enzyme is a calcium-dependent homodimer which uses PQQ as a cofactor [].; GO: 0016901 oxidoreductase activity, acting on the CH-OH group of donors, quinone or similar compound as acceptor, 0048038 quinone binding, 0005975 carbohydrate metabolic process; PDB: 2ISM_A 2WG3_D 3HO5_A 3HO4_A 3HO3_A 2WFT_A 2WG4_B 2WFX_B 1CRU_A 1CQ1_B ....
Probab=78.11  E-value=15  Score=45.96  Aligned_cols=111  Identities=13%  Similarity=0.171  Sum_probs=62.6

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC----CCEEEEEeCC------
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY----GHRFASAALD------ 2292 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD----G~~LASgS~D------ 2292 (2389)
                      ++++|.|||+++++ -..|+|++.+ .+|.....+..++  .+. .........++|+|+    |...++-+.+      
T Consensus         5 ~~~a~~pdG~l~v~-e~~G~i~~~~-~~g~~~~~v~~~~--~v~-~~~~~gllgia~~p~f~~n~~lYv~~t~~~~~~~~   79 (331)
T PF07995_consen    5 RSMAFLPDGRLLVA-ERSGRIWVVD-KDGSLKTPVADLP--EVF-ADGERGLLGIAFHPDFASNGYLYVYYTNADEDGGD   79 (331)
T ss_dssp             EEEEEETTSCEEEE-ETTTEEEEEE-TTTEECEEEEE-T--TTB-TSTTBSEEEEEE-TTCCCC-EEEEEEEEE-TSSSS
T ss_pred             eEEEEeCCCcEEEE-eCCceEEEEe-CCCcCcceecccc--ccc-ccccCCcccceeccccCCCCEEEEEEEcccCCCCC
Confidence            88999999999886 5599999999 5565412221111  111 122467899999995    7777776643      


Q ss_pred             --CcEEEeeCCCCCc--cCcccc-eeeee---cCCCeeEEEEecCCCCEEEEeec
Q 000080         2293 --GTVCTWQLEVGGR--SNVRPM-ESCLC---FSSHAMDVSYITSSGSVIAAAGH 2339 (2389)
Q Consensus      2293 --gTVkLWDl~tggr--s~~k~l-~tl~g---Hs~~V~sVAFSP~DGslLASAG~ 2339 (2389)
                        ..|.-|.+..+..  ...+.+ ..+..   ..+....++|.| ||.+.++.|.
T Consensus        80 ~~~~v~r~~~~~~~~~~~~~~~l~~~~p~~~~~~H~g~~l~fgp-DG~LYvs~G~  133 (331)
T PF07995_consen   80 NDNRVVRFTLSDGDGDLSSEEVLVTGLPDTSSGNHNGGGLAFGP-DGKLYVSVGD  133 (331)
T ss_dssp             EEEEEEEEEEETTSCEEEEEEEEEEEEES-CSSSS-EEEEEE-T-TSEEEEEEB-
T ss_pred             cceeeEEEeccCCccccccceEEEEEeCCCCCCCCCCccccCCC-CCcEEEEeCC
Confidence              3444444432210  001112 12222   234456799999 9999998874


No 348
>KOG2079 consensus Vacuolar assembly/sorting protein VPS8 [Intracellular trafficking, secretion, and vesicular transport]
Probab=77.62  E-value=5.4  Score=55.45  Aligned_cols=72  Identities=13%  Similarity=0.310  Sum_probs=54.2

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .+|.+++|+.||.+++.|=.+|.|.+||+.+++.++.+.   .|..|   | ..|-.+-...++..+.++...|.  +|+
T Consensus       131 ~~Vtsvafn~dg~~l~~G~~~G~V~v~D~~~~k~l~~i~---e~~ap---~-t~vi~v~~t~~nS~llt~D~~Gs--f~~  201 (1206)
T KOG2079|consen  131 GPVTSVAFNQDGSLLLAGLGDGHVTVWDMHRAKILKVIT---EHGAP---V-TGVIFVGRTSQNSKLLTSDTGGS--FWK  201 (1206)
T ss_pred             CcceeeEecCCCceeccccCCCcEEEEEccCCcceeeee---ecCCc---c-ceEEEEEEeCCCcEEEEccCCCc--eEE
Confidence            367999999999999999999999999999998877664   23212   2 23444455566678888888885  675


Q ss_pred             C
Q 000080         2300 L 2300 (2389)
Q Consensus      2300 l 2300 (2389)
                      +
T Consensus       202 l  202 (1206)
T KOG2079|consen  202 L  202 (1206)
T ss_pred             E
Confidence            4


No 349
>PF12894 Apc4_WD40:  Anaphase-promoting complex subunit 4 WD40 domain
Probab=77.22  E-value=4.4  Score=37.59  Aligned_cols=33  Identities=9%  Similarity=0.243  Sum_probs=29.1

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT 2254 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l 2254 (2389)
                      .|..++|+|+..+||.|+.||.|.++.+ +++.+
T Consensus        13 ~v~~~~w~P~mdLiA~~t~~g~v~v~Rl-~~qri   45 (47)
T PF12894_consen   13 RVSCMSWCPTMDLIALGTEDGEVLVYRL-NWQRI   45 (47)
T ss_pred             cEEEEEECCCCCEEEEEECCCeEEEEEC-CCcCc
Confidence            3588999999999999999999999998 66643


No 350
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=76.31  E-value=26  Score=48.36  Aligned_cols=111  Identities=13%  Similarity=0.129  Sum_probs=73.9

Q ss_pred             EEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCc-----EEEeeC
Q 000080         2226 SSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGT-----VCTWQL 2300 (2389)
Q Consensus      2226 AFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgT-----VkLWDl 2300 (2389)
                      ++++.+..+|-|+.||.|-+.+- +-+.++.|+   ++.     | +-|..+..-.+.+.|+|.++|++     |++||+
T Consensus        30 c~~s~~~~vvigt~~G~V~~Ln~-s~~~~~~fq---a~~-----~-siv~~L~~~~~~~~L~sv~Ed~~~np~llkiw~l   99 (933)
T KOG2114|consen   30 CCSSSTGSVVIGTADGRVVILNS-SFQLIRGFQ---AYE-----Q-SIVQFLYILNKQNFLFSVGEDEQGNPVLLKIWDL   99 (933)
T ss_pred             EEcCCCceEEEeeccccEEEecc-cceeeehhe---ecc-----h-hhhhHhhcccCceEEEEEeecCCCCceEEEEecc
Confidence            58999999999999998877763 223445554   331     1 23555555556689999888865     999999


Q ss_pred             CCCCccC-ccccee--eee-----cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2301 EVGGRSN-VRPMES--CLC-----FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2301 ~tggrs~-~k~l~t--l~g-----Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      +.....+ +++++.  ...     -+.++..++.+. |=+.+|. |+  .||+|-...
T Consensus       100 ek~~~n~sP~c~~~~ri~~~~np~~~~p~s~l~Vs~-~l~~Iv~-Gf--~nG~V~~~~  153 (933)
T KOG2114|consen  100 EKVDKNNSPQCLYEHRIFTIKNPTNPSPASSLAVSE-DLKTIVC-GF--TNGLVICYK  153 (933)
T ss_pred             cccCCCCCcceeeeeeeeccCCCCCCCcceEEEEEc-cccEEEE-Ee--cCcEEEEEc
Confidence            8642112 334422  122     245677899998 6788887 55  688888876


No 351
>PF10647 Gmad1:  Lipoprotein LpqB beta-propeller domain;  InterPro: IPR018910  The Gmad1 domain is found associated with IPR019606 from INTERPRO, in bacterial spore formation. It is predicted to have a beta-propeller fold and to have a passive binding role rather than a catalytic function owing to the low number of conserved hydrophilic residues. 
Probab=76.24  E-value=32  Score=41.51  Aligned_cols=115  Identities=18%  Similarity=0.132  Sum_probs=71.2

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEee-cCCCceeeE-ecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe---CCCcEEE
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWE-FGKDKATAT-YGVLPAANVPPPYALASISALQFDHYGHRFASAA---LDGTVCT 2297 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWD-l~tGk~l~T-l~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS---~DgTVkL 2297 (2389)
                      .+-+|.++|...+....+...+++. ..+|+.... ...      +  +-...|+++++||||.++|.-.   .++.|.+
T Consensus        69 ~~PS~d~~g~~W~v~~~~~~~~~~~~~~~g~~~~~~v~~------~--~~~~~I~~l~vSpDG~RvA~v~~~~~~~~v~v  140 (253)
T PF10647_consen   69 TRPSWDPDGWVWTVDDGSGGVRVVRDSASGTGEPVEVDW------P--GLRGRITALRVSPDGTRVAVVVEDGGGGRVYV  140 (253)
T ss_pred             ccccccCCCCEEEEEcCCCceEEEEecCCCcceeEEecc------c--ccCCceEEEEECCCCcEEEEEEecCCCCeEEE
Confidence            5558999998888777788888884 334443222 210      1  1112799999999999999877   3466666


Q ss_pred             eeCCCCCc----cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEE
Q 000080         2298 WQLEVGGR----SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVV 2348 (2389)
Q Consensus      2298 WDl~tggr----s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrL 2348 (2389)
                      =-+...+.    ....++.........+.+++|.+ ++++++.+.  ..|..+..
T Consensus       141 a~V~r~~~g~~~~l~~~~~~~~~~~~~v~~v~W~~-~~~L~V~~~--~~~~~~~~  192 (253)
T PF10647_consen  141 AGVVRDGDGVPRRLTGPRRVAPPLLSDVTDVAWSD-DSTLVVLGR--SAGGPVVR  192 (253)
T ss_pred             EEEEeCCCCCcceeccceEecccccCcceeeeecC-CCEEEEEeC--CCCCceeE
Confidence            55543211    01122222223456889999999 777776543  45555544


No 352
>PF14870 PSII_BNR:  Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=76.10  E-value=24  Score=44.11  Aligned_cols=105  Identities=15%  Similarity=0.188  Sum_probs=57.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      .++++..++||+++|.++...-.+-||-+.. .....-           .-..+|.++.|+|||.....+ ..|.|+.=+
T Consensus       146 s~~~~~r~~dG~~vavs~~G~~~~s~~~G~~~w~~~~r-----------~~~~riq~~gf~~~~~lw~~~-~Gg~~~~s~  213 (302)
T PF14870_consen  146 SINDITRSSDGRYVAVSSRGNFYSSWDPGQTTWQPHNR-----------NSSRRIQSMGFSPDGNLWMLA-RGGQIQFSD  213 (302)
T ss_dssp             -EEEEEE-TTS-EEEEETTSSEEEEE-TT-SS-EEEE-------------SSS-EEEEEE-TTS-EEEEE-TTTEEEEEE
T ss_pred             eeEeEEECCCCcEEEEECcccEEEEecCCCccceEEcc-----------CccceehhceecCCCCEEEEe-CCcEEEEcc
Confidence            3478899999999999877777789996533 222221           124789999999998876655 778777755


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEee
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG 2338 (2389)
                      .......-.+++....--...+.+++|.+ ++++.|++|
T Consensus       214 ~~~~~~~w~~~~~~~~~~~~~~ld~a~~~-~~~~wa~gg  251 (302)
T PF14870_consen  214 DPDDGETWSEPIIPIKTNGYGILDLAYRP-PNEIWAVGG  251 (302)
T ss_dssp             -TTEEEEE---B-TTSS--S-EEEEEESS-SS-EEEEES
T ss_pred             CCCCccccccccCCcccCceeeEEEEecC-CCCEEEEeC
Confidence            11100000011111111123478999999 778888764


No 353
>PF10168 Nup88:  Nuclear pore component;  InterPro: IPR019321  Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells []. 
Probab=75.70  E-value=9.7  Score=52.31  Aligned_cols=88  Identities=22%  Similarity=0.297  Sum_probs=59.5

Q ss_pred             CCCCCCcceeecCCCCCCeEEEEecCCcEEEEeCCCC---cccccccccccceeeeec------cCCCCCeeEEEEcCCC
Q 000080           36 APTRSTSTIDWLPDFAGYSWVAYGASSLLVISHFPSP---LSQEEALIGPIFRQVFAL------SDNSLPVTSISWSPET  106 (2389)
Q Consensus        36 ap~~~~~ai~wlpD~~G~~~vAYasg~~vVI~~l~SP---~~~~e~~~~p~~~Qvieg------h~d~~dVk~VaWSPd~  106 (2389)
                      .|.-++..|..+|+  | ..+|-.+...|+|..||..   ...|+-.---+.+..++.      ......|..|+|||..
T Consensus        82 ~~~f~v~~i~~n~~--g-~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~~~~~~~~~~~~i~qv~WhP~s  158 (717)
T PF10168_consen   82 PPLFEVHQISLNPT--G-SLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVDERFFTSNSSLEIKQVRWHPWS  158 (717)
T ss_pred             CCceeEEEEEECCC--C-CEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEechhhccCCCCceEEEEEEcCCC
Confidence            36678888888888  7 5899999999999999862   222321111123444422      1112579999999974


Q ss_pred             CCCCcEEE-ecCCeEEEEeeC
Q 000080          107 PSIGQLAA-ASENCIFVFAHD  126 (2389)
Q Consensus       107 ~~~GeIaA-SyDntIRVw~~d  126 (2389)
                      +.+.-|++ .+||++|+|.-.
T Consensus       159 ~~~~~l~vLtsdn~lR~y~~~  179 (717)
T PF10168_consen  159 ESDSHLVVLTSDNTLRLYDIS  179 (717)
T ss_pred             CCCCeEEEEecCCEEEEEecC
Confidence            44455665 789999999875


No 354
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=74.96  E-value=34  Score=43.22  Aligned_cols=148  Identities=7%  Similarity=-0.023  Sum_probs=79.2

Q ss_pred             EEEEEcCCCCeEEEEe-----------CCC-cEEEeecCC--Cce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCEE
Q 000080         2223 RAFSSHPLRPFFLVGS-----------SNT-HIYLWEFGK--DKA--TATYGVLPAANVPPPYALASISALQFDHYGHRF 2286 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS-----------~Dg-TIRLWDl~t--Gk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~L 2286 (2389)
                      ++|+|.++|+++++-.           ..+ .|.+++-.+  |+.  ...|.   .       .....+.++|.++| .+
T Consensus        17 ~~ia~d~~G~l~V~e~~~y~~~~~~~~~~~~rI~~l~d~dgdG~~d~~~vfa---~-------~l~~p~Gi~~~~~G-ly   85 (367)
T TIGR02604        17 IAVCFDERGRLWVAEGITYSRPAGRQGPLGDRILILEDADGDGKYDKSNVFA---E-------ELSMVTGLAVAVGG-VY   85 (367)
T ss_pred             ceeeECCCCCEEEEeCCcCCCCCCCCCCCCCEEEEEEcCCCCCCcceeEEee---c-------CCCCccceeEecCC-EE
Confidence            7889999999888743           223 787776543  332  23331   1       12446889999999 66


Q ss_pred             EEEeCCCcEEEeeCCCCCcc--Ccccce-eeee----cCCCeeEEEEecCCCCEEEEeecCCCCCe--------------
Q 000080         2287 ASAALDGTVCTWQLEVGGRS--NVRPME-SCLC----FSSHAMDVSYITSSGSVIAAAGHSSNGIN-------------- 2345 (2389)
Q Consensus      2287 ASgS~DgTVkLWDl~tggrs--~~k~l~-tl~g----Hs~~V~sVAFSP~DGslLASAG~sS~D~T-------------- 2345 (2389)
                      ++ +.+.-.++.|.+..++.  ..+.+. .+..    +......++|.| ||.+.++-|..+.-.+              
T Consensus        86 V~-~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~~~~~~~~~~l~~gp-DG~LYv~~G~~~~~~~~~~~~~~~~~~~~~  163 (367)
T TIGR02604        86 VA-TPPDILFLRDKDGDDKADGEREVLLSGFGGQINNHHHSLNSLAWGP-DGWLYFNHGNTLASKVTRPGTSDESRQGLG  163 (367)
T ss_pred             Ee-CCCeEEEEeCCCCCCCCCCccEEEEEccCCCCCcccccccCceECC-CCCEEEecccCCCceeccCCCccCcccccC
Confidence            64 45554455566432110  001121 1211    234467899999 9999887652110000              


Q ss_pred             EEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2346 VVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2346 VrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                      =.+|.+. +.+..+..+...-...+.++++++|+.-++-
T Consensus       164 g~i~r~~-pdg~~~e~~a~G~rnp~Gl~~d~~G~l~~td  201 (367)
T TIGR02604       164 GGLFRYN-PDGGKLRVVAHGFQNPYGHSVDSWGDVFFCD  201 (367)
T ss_pred             ceEEEEe-cCCCeEEEEecCcCCCccceECCCCCEEEEc
Confidence            0244432 2233333332222234578888888876553


No 355
>KOG2444 consensus WD40 repeat protein [General function prediction only]
Probab=74.79  E-value=5.5  Score=47.69  Aligned_cols=68  Identities=16%  Similarity=0.114  Sum_probs=50.8

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCC-CCEEEEEECCCCCEEEEE--eCCCcEEEeeCC
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYAL-ASISALQFDHYGHRFASA--ALDGTVCTWQLE 2301 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~-~~V~sVaFSPDG~~LASg--S~DgTVkLWDl~ 2301 (2389)
                      |.--.++.+..+|+.||.||.|++..++-+- +.   +      +|. ..+....-+.-|+.++++  |.|.+++.|+++
T Consensus       108 Ip~~~~~~~~c~~~~dg~ir~~n~~p~k~~g-~~---g------~h~~~~~e~~ivv~sd~~i~~a~~S~d~~~k~W~ve  177 (238)
T KOG2444|consen  108 IPNGRDSSLGCVGAQDGRIRACNIKPNKVLG-YV---G------QHNFESGEELIVVGSDEFLKIADTSHDRVLKKWNVE  177 (238)
T ss_pred             cccccccceeEEeccCCceeeeccccCceee-ee---c------cccCCCcceeEEecCCceEEeeccccchhhhhcchh
Confidence            3445566688999999999999998777543 22   1      244 456666666777888888  999999999997


Q ss_pred             C
Q 000080         2302 V 2302 (2389)
Q Consensus      2302 t 2302 (2389)
                      .
T Consensus       178 ~  178 (238)
T KOG2444|consen  178 K  178 (238)
T ss_pred             h
Confidence            5


No 356
>KOG2114 consensus Vacuolar assembly/sorting protein PEP5/VPS11 [Intracellular trafficking, secretion, and vesicular transport]
Probab=74.35  E-value=41  Score=46.57  Aligned_cols=132  Identities=14%  Similarity=0.135  Sum_probs=89.4

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEee--cCCCceee-EecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWE--FGKDKATA-TYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCT 2297 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWD--l~tGk~l~-Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkL 2297 (2389)
                      ++..|+.|.+-+.+|.|=.||.|.+..  +.+.+-.+ .+.    |+    | ..+|+.++|.-||+...-+..-..|.+
T Consensus       127 p~s~l~Vs~~l~~Iv~Gf~nG~V~~~~GDi~RDrgsr~~~~----~~----~-~~pITgL~~~~d~~s~lFv~Tt~~V~~  197 (933)
T KOG2114|consen  127 PASSLAVSEDLKTIVCGFTNGLVICYKGDILRDRGSRQDYS----HR----G-KEPITGLALRSDGKSVLFVATTEQVML  197 (933)
T ss_pred             cceEEEEEccccEEEEEecCcEEEEEcCcchhccccceeee----cc----C-CCCceeeEEecCCceeEEEEecceeEE
Confidence            567889999999999999999999985  22222222 232    11    1 267999999999987333444467999


Q ss_pred             eeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE-eecCcEEEE
Q 000080         2298 WQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT-CHEGLYDLF 2372 (2389)
Q Consensus      2298 WDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~-GH~~~V~sv 2372 (2389)
                      +.+. | |.  .....+..|...+++.+|++.++++|.+ |    +.-|.++|..  ..+..-.|. ||.....++
T Consensus       198 y~l~-g-r~--p~~~~ld~~G~~lnCss~~~~t~qfIca-~----~e~l~fY~sd--~~~~cfaf~~g~kk~~~~~  262 (933)
T KOG2114|consen  198 YSLS-G-RT--PSLKVLDNNGISLNCSSFSDGTYQFICA-G----SEFLYFYDSD--GRGPCFAFEVGEKKEMLVF  262 (933)
T ss_pred             EEec-C-CC--cceeeeccCCccceeeecCCCCccEEEe-c----CceEEEEcCC--CcceeeeecCCCeEEEEEE
Confidence            9988 3 21  1245577888999999999866666664 2    4579999962  223345666 766555443


No 357
>PF08553 VID27:  VID27 cytoplasmic protein;  InterPro: IPR013863  This entry represents fungal and plant proteins and contains many hypothetical proteins. Vid27p is a cytoplasmic protein of unknown function, possibly regulates import of fructose-1,6-bisphosphatase into Vacuolar Import and Degradation (Vid) vesicles and is not essential for proteasome-dependent degradation of fructose-1,6-bisphosphatase (FBPase) [, ].
Probab=73.92  E-value=27  Score=48.62  Aligned_cols=104  Identities=14%  Similarity=0.198  Sum_probs=73.1

Q ss_pred             EEEEeCCCcEEEeecCCC--ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccc
Q 000080         2234 FLVGSSNTHIYLWEFGKD--KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPM 2311 (2389)
Q Consensus      2234 LASGS~DgTIRLWDl~tG--k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l 2311 (2389)
                      -..|=.+..+-.||.+-.  +++.+    ..|..   ......+|++=+.+| .||.||.+|-|||+| +.|.    +.-
T Consensus       545 tflGls~n~lfriDpR~~~~k~v~~----~~k~Y---~~~~~Fs~~aTt~~G-~iavgs~~G~IRLyd-~~g~----~AK  611 (794)
T PF08553_consen  545 TFLGLSDNSLFRIDPRLSGNKLVDS----QSKQY---SSKNNFSCFATTEDG-YIAVGSNKGDIRLYD-RLGK----RAK  611 (794)
T ss_pred             eEEEECCCceEEeccCCCCCceeec----ccccc---ccCCCceEEEecCCc-eEEEEeCCCcEEeec-ccch----hhh
Confidence            344778888999998743  23321    11211   122457788888888 799999999999998 4442    333


Q ss_pred             eeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCC
Q 000080         2312 ESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPP 2355 (2389)
Q Consensus      2312 ~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~t 2355 (2389)
                      ..+.|...+|..|..+. ||++|+.+    -+.-+-|.|+....
T Consensus       612 T~lp~lG~pI~~iDvt~-DGkwilaT----c~tyLlLi~t~~~~  650 (794)
T PF08553_consen  612 TALPGLGDPIIGIDVTA-DGKWILAT----CKTYLLLIDTLIKD  650 (794)
T ss_pred             hcCCCCCCCeeEEEecC-CCcEEEEe----ecceEEEEEEeeec
Confidence            44567789999999999 99988753    47789999985433


No 358
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=73.88  E-value=70  Score=41.57  Aligned_cols=144  Identities=13%  Similarity=0.250  Sum_probs=85.1

Q ss_pred             eeecCCCCCCeEEEEecCCcEEEEeCCCCcccc-cccccccceeeeeccCCCCCeeEEEEcCCCCCCCcEEEecCCeEEE
Q 000080           44 IDWLPDFAGYSWVAYGASSLLVISHFPSPLSQE-EALIGPIFRQVFALSDNSLPVTSISWSPETPSIGQLAAASENCIFV  122 (2389)
Q Consensus        44 i~wlpD~~G~~~vAYasg~~vVI~~l~SP~~~~-e~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~GeIaASyDntIRV  122 (2389)
                      +.-++|  | ..++++....++.++  ++-..+ +.+         +... ...+..+.|.++   ++-++++-++.+. 
T Consensus       244 v~~~~d--G-~~~~vg~~G~~~~s~--d~G~~~W~~~---------~~~~-~~~l~~v~~~~d---g~l~l~g~~G~l~-  304 (398)
T PLN00033        244 VNRSPD--G-DYVAVSSRGNFYLTW--EPGQPYWQPH---------NRAS-ARRIQNMGWRAD---GGLWLLTRGGGLY-  304 (398)
T ss_pred             EEEcCC--C-CEEEEECCccEEEec--CCCCcceEEe---------cCCC-ccceeeeeEcCC---CCEEEEeCCceEE-
Confidence            344566  6 488999988888888  422221 222         2221 246899999997   5445566555543 


Q ss_pred             EeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc-eEEeeccCCcEEEEEEeeccccceEEEEeecCCCc
Q 000080          123 FAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME-TVLWKKKNTLWEIAWKFKENYPQNLVSATWSIEGP  201 (2389)
Q Consensus       123 w~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD-V~IW~~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~  201 (2389)
                      +..+...+-...+|.....-.....+.++.|.+++..+++|... +.........|+.+=. ...-+.++|++.|.+++.
T Consensus       305 ~S~d~G~~~~~~~f~~~~~~~~~~~l~~v~~~~d~~~~a~G~~G~v~~s~D~G~tW~~~~~-~~~~~~~ly~v~f~~~~~  383 (398)
T PLN00033        305 VSKGTGLTEEDFDFEEADIKSRGFGILDVGYRSKKEAWAAGGSGILLRSTDGGKSWKRDKG-ADNIAANLYSVKFFDDKK  383 (398)
T ss_pred             EecCCCCcccccceeecccCCCCcceEEEEEcCCCcEEEEECCCcEEEeCCCCcceeEccc-cCCCCcceeEEEEcCCCc
Confidence            33331100000122221111123468999999999988888887 4455556678987521 122356899999988888


Q ss_pred             -eEeeec
Q 000080          202 -SATAAS  207 (2389)
Q Consensus       202 -fATag~  207 (2389)
                       +|++-.
T Consensus       384 g~~~G~~  390 (398)
T PLN00033        384 GFVLGND  390 (398)
T ss_pred             eEEEeCC
Confidence             887743


No 359
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=72.41  E-value=7.2  Score=50.11  Aligned_cols=144  Identities=15%  Similarity=0.050  Sum_probs=91.7

Q ss_pred             EcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC-CCcEEEeeCCCCCc
Q 000080         2227 SHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL-DGTVCTWQLEVGGR 2305 (2389)
Q Consensus      2227 FsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~-DgTVkLWDl~tggr 2305 (2389)
                      |-.-..++++||-||++|.|--. +-....|-   -|.   ..|...|.+++-|.||..+.|++. |..+|+.|++.-. 
T Consensus        16 ~~tka~fiiqASlDGh~KFWkKs-~isGvEfV---KhF---raHL~~I~sl~~S~dg~L~~Sv~d~Dhs~KvfDvEn~D-   87 (558)
T KOG0882|consen   16 FPTKAKFIIQASLDGHKKFWKKS-RISGVEFV---KHF---RAHLGVILSLAVSYDGWLFRSVEDPDHSVKVFDVENFD-   87 (558)
T ss_pred             eeehhheEEeeecchhhhhcCCC-Cccceeeh---hhh---HHHHHHHHhhhccccceeEeeccCcccceeEEEeeccc-
Confidence            44457799999999999999853 21122221   111   236688999999999999999888 9999999998742 


Q ss_pred             cCcccceeeeecCCCeeEEEEecCCCC-EEEEeecCCCCCeEEEeeCCCCCCCce-EEEEeecCcEEEEeecccchhhhc
Q 000080         2306 SNVRPMESCLCFSSHAMDVSYITSSGS-VIAAAGHSSNGINVVVWDTLAPPTSSR-ASITCHEGLYDLFLPLKLLNFALS 2383 (2389)
Q Consensus      2306 s~~k~l~tl~gHs~~V~sVAFSP~DGs-lLASAG~sS~D~TVrLWD~l~~tg~~v-~sL~GH~~~V~svA~~~~~~~~~s 2383 (2389)
                       ... ...+.-..+.+ +..++|+|-. .||.+  .-+++.|-+.|-. ...... ..-.-|.++|.++-..+-|+-++|
T Consensus        88 -min-miKL~~lPg~a-~wv~skGd~~s~IAVs--~~~sg~i~VvD~~-~d~~q~~~fkklH~sPV~~i~y~qa~Ds~vS  161 (558)
T KOG0882|consen   88 -MIN-MIKLVDLPGFA-EWVTSKGDKISLIAVS--LFKSGKIFVVDGF-GDFCQDGYFKKLHFSPVKKIRYNQAGDSAVS  161 (558)
T ss_pred             -hhh-hcccccCCCce-EEecCCCCeeeeEEee--cccCCCcEEECCc-CCcCccceecccccCceEEEEeeccccceee
Confidence             111 11111122222 2334542212 44443  2477889999963 122223 333459999999999998888777


Q ss_pred             c
Q 000080         2384 K 2384 (2389)
Q Consensus      2384 ~ 2384 (2389)
                      -
T Consensus       162 i  162 (558)
T KOG0882|consen  162 I  162 (558)
T ss_pred             c
Confidence            4


No 360
>PF12894 Apc4_WD40:  Anaphase-promoting complex subunit 4 WD40 domain
Probab=72.15  E-value=7.5  Score=36.14  Aligned_cols=30  Identities=20%  Similarity=0.279  Sum_probs=28.2

Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      ..|..++|+|..+.||.|+.||.|.++.++
T Consensus        12 ~~v~~~~w~P~mdLiA~~t~~g~v~v~Rl~   41 (47)
T PF12894_consen   12 SRVSCMSWCPTMDLIALGTEDGEVLVYRLN   41 (47)
T ss_pred             CcEEEEEECCCCCEEEEEECCCeEEEEECC
Confidence            569999999999999999999999999884


No 361
>PF14783 BBS2_Mid:  Ciliary BBSome complex subunit 2, middle region
Probab=71.47  E-value=59  Score=35.60  Aligned_cols=99  Identities=17%  Similarity=0.163  Sum_probs=59.9

Q ss_pred             eeEEEEcCC-CCCCCcEEE-ecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEec-c-eEEeec
Q 000080           97 VTSISWSPE-TPSIGQLAA-ASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGM-E-TVLWKK  172 (2389)
Q Consensus        97 Vk~VaWSPd-~~~~GeIaA-SyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggd-D-V~IW~~  172 (2389)
                      |.+++.+.- .+|..+|++ |-|..||||+.+      +    ....++.+.+|-++.=.+.+ +.+-+-. + |.+++.
T Consensus         2 V~al~~~d~d~dg~~eLlvGs~D~~IRvf~~~------e----~~~Ei~e~~~v~~L~~~~~~-~F~Y~l~NGTVGvY~~   70 (111)
T PF14783_consen    2 VTALCLFDFDGDGENELLVGSDDFEIRVFKGD------E----IVAEITETDKVTSLCSLGGG-RFAYALANGTVGVYDR   70 (111)
T ss_pred             eeEEEEEecCCCCcceEEEecCCcEEEEEeCC------c----EEEEEecccceEEEEEcCCC-EEEEEecCCEEEEEeC
Confidence            566666652 223346776 568999999987      2    23344578888888877764 4554444 3 999998


Q ss_pred             cCCcEEEEEEeecccc-ceEEEEeecCCCc--eEeeecccc
Q 000080          173 KNTLWEIAWKFKENYP-QNLVSATWSIEGP--SATAASMSQ  210 (2389)
Q Consensus       173 ~~s~Wecvwt~~~~~~-~~ivsvaWSpdG~--fATag~dik  210 (2389)
                      ....|+.-    ..+. ..+..++-.-||.  +.++-...|
T Consensus        71 ~~RlWRiK----SK~~~~~~~~~D~~gdG~~eLI~GwsnGk  107 (111)
T PF14783_consen   71 SQRLWRIK----SKNQVTSMAFYDINGDGVPELIVGWSNGK  107 (111)
T ss_pred             cceeeeec----cCCCeEEEEEEcCCCCCceEEEEEecCCe
Confidence            77777743    3332 2222333334565  777755443


No 362
>PF11715 Nup160:  Nucleoporin Nup120/160;  InterPro: IPR021717  Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=70.58  E-value=14  Score=48.80  Aligned_cols=36  Identities=14%  Similarity=0.311  Sum_probs=28.2

Q ss_pred             EEEEEcC----CCCeEEEEeCCCcEEEeecCCCceeeEec
Q 000080         2223 RAFSSHP----LRPFFLVGSSNTHIYLWEFGKDKATATYG 2258 (2389)
Q Consensus      2223 rsVAFsP----dG~~LASGS~DgTIRLWDl~tGk~l~Tl~ 2258 (2389)
                      .+++.++    +..+|++-+.|+++|+||+.+++++.+..
T Consensus       218 ~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~~~~~~~  257 (547)
T PF11715_consen  218 ASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQCLATID  257 (547)
T ss_dssp             EEEEE-----ETTTEEEEEETTSEEEEEETTTTCEEEEEE
T ss_pred             ceEEEecceeCCCCEEEEEeCCCeEEEEECCCCeEEEEec
Confidence            3445555    67789999999999999999999977754


No 363
>COG3391 Uncharacterized conserved protein [Function unknown]
Probab=70.43  E-value=72  Score=40.76  Aligned_cols=136  Identities=13%  Similarity=0.032  Sum_probs=87.4

Q ss_pred             EEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC---CCcEEEe
Q 000080         2223 RAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL---DGTVCTW 2298 (2389)
Q Consensus      2223 rsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~---DgTVkLW 2298 (2389)
                      ..++++++|+ .+++...+.+|++-|..+.+.+.+..+         |.  .-..++|+|+|+.+-.+..   +++|.+-
T Consensus        77 ~~i~v~~~~~~vyv~~~~~~~v~vid~~~~~~~~~~~v---------G~--~P~~~~~~~~~~~vYV~n~~~~~~~vsvi  145 (381)
T COG3391          77 AGVAVNPAGNKVYVTTGDSNTVSVIDTATNTVLGSIPV---------GL--GPVGLAVDPDGKYVYVANAGNGNNTVSVI  145 (381)
T ss_pred             cceeeCCCCCeEEEecCCCCeEEEEcCcccceeeEeee---------cc--CCceEEECCCCCEEEEEecccCCceEEEE
Confidence            3568899888 677777789999999877777766531         21  4578999999965555444   6888888


Q ss_pred             eCCCCCccCccccee-eeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE-----EEeecCcEEEE
Q 000080         2299 QLEVGGRSNVRPMES-CLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS-----ITCHEGLYDLF 2372 (2389)
Q Consensus      2299 Dl~tggrs~~k~l~t-l~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s-----L~GH~~~V~sv 2372 (2389)
                      |-.+.     +...+ ..|- .+ ..+++.| +|+.+..+-  +.+++|-+-|+.   +..+..     ...-...=.-+
T Consensus       146 d~~t~-----~~~~~~~vG~-~P-~~~a~~p-~g~~vyv~~--~~~~~v~vi~~~---~~~v~~~~~~~~~~~~~~P~~i  212 (381)
T COG3391         146 DAATN-----KVTATIPVGN-TP-TGVAVDP-DGNKVYVTN--SDDNTVSVIDTS---GNSVVRGSVGSLVGVGTGPAGI  212 (381)
T ss_pred             eCCCC-----eEEEEEecCC-Cc-ceEEECC-CCCeEEEEe--cCCCeEEEEeCC---CcceeccccccccccCCCCceE
Confidence            87765     22322 2222 23 7899999 888555542  578999999962   222221     11111222467


Q ss_pred             eecccchhhh
Q 000080         2373 LPLKLLNFAL 2382 (2389)
Q Consensus      2373 A~~~~~~~~~ 2382 (2389)
                      +..++|+++-
T Consensus       213 ~v~~~g~~~y  222 (381)
T COG3391         213 AVDPDGNRVY  222 (381)
T ss_pred             EECCCCCEEE
Confidence            7777777653


No 364
>PF04053 Coatomer_WDAD:  Coatomer WD associated region ;  InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits.  This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=68.76  E-value=9.2  Score=49.83  Aligned_cols=86  Identities=28%  Similarity=0.299  Sum_probs=62.9

Q ss_pred             HHHHHHHHHHHHHHHhccCCcchhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHhhcc
Q 000080         1244 TQLRTRMEKLARLQYLKKKDPKDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLLGRH 1323 (2389)
Q Consensus      1244 ~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLLsK~ 1323 (2389)
                      .+|++-==++|..-|++.+|.....|+|++.|.+.-|..|-+++...+ +.+..|                         
T Consensus       356 ~AL~~g~~~lAe~c~~k~~d~~~L~lLy~~~g~~~~L~kl~~~a~~~~-~~n~af-------------------------  409 (443)
T PF04053_consen  356 EALRQGNIELAEECYQKAKDFSGLLLLYSSTGDREKLSKLAKIAEERG-DINIAF-------------------------  409 (443)
T ss_dssp             HHHHTTBHHHHHHHHHHCT-HHHHHHHHHHCT-HHHHHHHHHHHHHTT--HHHHH-------------------------
T ss_pred             HHHHcCCHHHHHHHHHhhcCccccHHHHHHhCCHHHHHHHHHHHHHcc-CHHHHH-------------------------
Confidence            345544455999999999999999999999999999888887765322 223333                         


Q ss_pred             hhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhh
Q 000080         1324 QLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLV 1362 (2389)
Q Consensus      1324 Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLy 1362 (2389)
                            .-+++-|+++++|+++.+- +-+++|.+.||-|
T Consensus       410 ------~~~~~lgd~~~cv~lL~~~-~~~~~A~~~A~ty  441 (443)
T PF04053_consen  410 ------QAALLLGDVEECVDLLIET-GRLPEAALFARTY  441 (443)
T ss_dssp             ------HHHHHHT-HHHHHHHHHHT-T-HHHHHHHHHHT
T ss_pred             ------HHHHHcCCHHHHHHHHHHc-CCchHHHHHHHhc
Confidence                  3345558899999998876 9999999999988


No 365
>PF06977 SdiA-regulated:  SdiA-regulated;  InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=67.59  E-value=60  Score=39.69  Aligned_cols=184  Identities=13%  Similarity=0.125  Sum_probs=96.7

Q ss_pred             cccccccccceeeccccc-cccccccccCCCCcC-----ceeEEE-----------EEEcCCCCeEEEEeCCCcEEEeec
Q 000080         2186 FGIPGYAGIGASALGWET-QDDFEDYVDPPATVE-----NISTRA-----------FSSHPLRPFFLVGSSNTHIYLWEF 2248 (2389)
Q Consensus      2186 ~~~~g~~~~~Asg~~~d~-~~~~~~~~d~~atv~-----ni~Vrs-----------VAFsPdG~~LASGS~DgTIRLWDl 2248 (2389)
                      .-+||-.+- +||+.|+. ...++...|.+..+-     +--++.           |++--++.++++--.++++.+.++
T Consensus        15 ~~l~g~~~e-~SGLTy~pd~~tLfaV~d~~~~i~els~~G~vlr~i~l~g~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~   93 (248)
T PF06977_consen   15 KPLPGILDE-LSGLTYNPDTGTLFAVQDEPGEIYELSLDGKVLRRIPLDGFGDYEGITYLGNGRYVLSEERDQRLYIFTI   93 (248)
T ss_dssp             EE-TT--S--EEEEEEETTTTEEEEEETTTTEEEEEETT--EEEEEE-SS-SSEEEEEE-STTEEEEEETTTTEEEEEEE
T ss_pred             eECCCccCC-ccccEEcCCCCeEEEEECCCCEEEEEcCCCCEEEEEeCCCCCCceeEEEECCCEEEEEEcCCCcEEEEEE
Confidence            345555553 78888874 566777766555421     111344           455556767776546899999998


Q ss_pred             CCCc---ee---eEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC--CCccC----cccceeeee
Q 000080         2249 GKDK---AT---ATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV--GGRSN----VRPMESCLC 2316 (2389)
Q Consensus      2249 ~tGk---~l---~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t--ggrs~----~k~l~tl~g 2316 (2389)
                      ....   ..   +.+..  +  .+ ..+...+-.|+++|.+++|..+-...-.+|+.++.  +....    ...+.....
T Consensus        94 ~~~~~~~~~~~~~~~~l--~--~~-~~~N~G~EGla~D~~~~~L~v~kE~~P~~l~~~~~~~~~~~~~~~~~~~~~~~~~  168 (248)
T PF06977_consen   94 DDDTTSLDRADVQKISL--G--FP-NKGNKGFEGLAYDPKTNRLFVAKERKPKRLYEVNGFPGGFDLFVSDDQDLDDDKL  168 (248)
T ss_dssp             ----TT--EEEEEEEE-------S----SS--EEEEEETTTTEEEEEEESSSEEEEEEESTT-SS--EEEE-HHHH-HT-
T ss_pred             eccccccchhhceEEec--c--cc-cCCCcceEEEEEcCCCCEEEEEeCCCChhhEEEccccCccceeeccccccccccc
Confidence            4322   11   22220  0  01 12335699999999999999999988888887764  11000    001111112


Q ss_pred             cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCce--EEEEeec-------CcEEEEeecccchhh
Q 000080         2317 FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSR--ASITCHE-------GLYDLFLPLKLLNFA 2381 (2389)
Q Consensus      2317 Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v--~sL~GH~-------~~V~svA~~~~~~~~ 2381 (2389)
                      +....++++|.|.+|++++-+   ...+.|-..|.   .|+.+  ..|..-.       .+.=-||+.++|+--
T Consensus       169 ~~~d~S~l~~~p~t~~lliLS---~es~~l~~~d~---~G~~~~~~~L~~g~~gl~~~~~QpEGIa~d~~G~LY  236 (248)
T PF06977_consen  169 FVRDLSGLSYDPRTGHLLILS---DESRLLLELDR---QGRVVSSLSLDRGFHGLSKDIPQPEGIAFDPDGNLY  236 (248)
T ss_dssp             -SS---EEEEETTTTEEEEEE---TTTTEEEEE-T---T--EEEEEE-STTGGG-SS---SEEEEEE-TT--EE
T ss_pred             eeccccceEEcCCCCeEEEEE---CCCCeEEEECC---CCCEEEEEEeCCcccCcccccCCccEEEECCCCCEE
Confidence            445678999999999988874   58899999994   56554  3443311       235588899988743


No 366
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=66.92  E-value=2.7  Score=55.61  Aligned_cols=112  Identities=14%  Similarity=0.290  Sum_probs=77.7

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECC-CCCEEEEEeCCCcEEEeeCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDH-YGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSP-DG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      .++++-.|.+++++|..-..|+++|++..- .+.-.+          .+..|..+..+| .++++++-+ ||.|.+||..
T Consensus       158 ns~cwlrd~klvlaGm~sr~~~ifdlRqs~-~~~~sv----------nTk~vqG~tVdp~~~nY~cs~~-dg~iAiwD~~  225 (783)
T KOG1008|consen  158 NSVCWLRDTKLVLAGMTSRSVHIFDLRQSL-DSVSSV----------NTKYVQGITVDPFSPNYFCSNS-DGDIAIWDTY  225 (783)
T ss_pred             cccccccCcchhhcccccchhhhhhhhhhh-hhhhhh----------hhhhcccceecCCCCCceeccc-cCceeeccch
Confidence            467888899999999999999999997332 111110          124578888999 789999888 9999999943


Q ss_pred             CCCccCcccceeeeecCC----CeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2302 VGGRSNVRPMESCLCFSS----HAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~----~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ..   ...++.+.+--..    .+..++|.|-.-.+||+-  .-+.+||++.|+
T Consensus       226 rn---ienpl~~i~~~~N~~~~~l~~~aycPtrtglla~l--~RdS~tIrlydi  274 (783)
T KOG1008|consen  226 RN---IENPLQIILRNENKKPKQLFALAYCPTRTGLLAVL--SRDSITIRLYDI  274 (783)
T ss_pred             hh---hccHHHHHhhCCCCcccceeeEEeccCCcchhhhh--ccCcceEEEecc
Confidence            21   1135544442222    388899998533455553  246689999997


No 367
>KOG3621 consensus WD40 repeat-containing protein [General function prediction only]
Probab=66.71  E-value=12  Score=50.49  Aligned_cols=108  Identities=15%  Similarity=0.247  Sum_probs=76.0

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      +..++.|++..++|.|++.|.|-++.+..+....-..+-+.|.    -|...|+++++|+||.++-+|..-|+|-+=-+.
T Consensus        79 ~~~~~vs~~e~lvAagt~~g~V~v~ql~~~~p~~~~~~t~~d~----~~~~rVTal~Ws~~~~k~ysGD~~Gkv~~~~L~  154 (726)
T KOG3621|consen   79 TCVRSVSSVEYLVAAGTASGRVSVFQLNKELPRDLDYVTPCDK----SHKCRVTALEWSKNGMKLYSGDSQGKVVLTELD  154 (726)
T ss_pred             EEEEEecchhHhhhhhcCCceEEeehhhccCCCcceeeccccc----cCCceEEEEEecccccEEeecCCCceEEEEEec
Confidence            4667899999999999999999999987654322212234442    367899999999999999999999999998777


Q ss_pred             CCCccCcccceeeeecCCCeeEEEEecCCCCEEEE
Q 000080         2302 VGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus      2302 tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
                      +. ....-+...+.-..+.|-.+.+..  +.+|++
T Consensus       155 s~-~~~~~~~q~il~~ds~IVQlD~~q--~~LLVS  186 (726)
T KOG3621|consen  155 SR-QAFLSKSQEILSEDSEIVQLDYLQ--SYLLVS  186 (726)
T ss_pred             hh-hhhccccceeeccCcceEEeeccc--ceehHh
Confidence            61 001112233333456777777764  455554


No 368
>KOG1008 consensus Uncharacterized conserved protein, contains WD40 repeats [Function unknown]
Probab=66.17  E-value=2.1  Score=56.46  Aligned_cols=139  Identities=9%  Similarity=0.067  Sum_probs=84.9

Q ss_pred             EEEEEcCC-CCeEEEEe----CCCcEEEeecCCCc--eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcE
Q 000080         2223 RAFSSHPL-RPFFLVGS----SNTHIYLWEFGKDK--ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTV 2295 (2389)
Q Consensus      2223 rsVAFsPd-G~~LASGS----~DgTIRLWDl~tGk--~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTV 2295 (2389)
                      .++||++- ...||.|=    .|..++|||+.++-  ...+..      +. .+-...+.+|++--|-+++.+|..-+.|
T Consensus       106 t~lAwneLDtn~LAagldkhrnds~~~Iwdi~s~ltvPke~~~------fs-~~~l~gqns~cwlrd~klvlaGm~sr~~  178 (783)
T KOG1008|consen  106 TSLAWNELDTNHLAAGLDKHRNDSSLKIWDINSLLTVPKESPL------FS-SSTLDGQNSVCWLRDTKLVLAGMTSRSV  178 (783)
T ss_pred             cccccccccHHHHHhhhhhhcccCCccceecccccCCCccccc------cc-cccccCccccccccCcchhhcccccchh
Confidence            45677774 45666553    56789999998762  111111      00 1123556788888888999999999999


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc----EEE
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL----YDL 2371 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~----V~s 2371 (2389)
                      ++.|++..   +.+. .  .--+..|..++..|-.+.++++    ..|+.|-+||+...-.+.++++...++.    +..
T Consensus       179 ~ifdlRqs---~~~~-~--svnTk~vqG~tVdp~~~nY~cs----~~dg~iAiwD~~rnienpl~~i~~~~N~~~~~l~~  248 (783)
T KOG1008|consen  179 HIFDLRQS---LDSV-S--SVNTKYVQGITVDPFSPNYFCS----NSDGDIAIWDTYRNIENPLQIILRNENKKPKQLFA  248 (783)
T ss_pred             hhhhhhhh---hhhh-h--hhhhhhcccceecCCCCCceec----cccCceeeccchhhhccHHHHHhhCCCCcccceee
Confidence            99999842   1011 0  1122355567777767789987    4699999999521112234444434443    666


Q ss_pred             Eeecccc
Q 000080         2372 FLPLKLL 2378 (2389)
Q Consensus      2372 vA~~~~~ 2378 (2389)
                      +|..|--
T Consensus       249 ~aycPtr  255 (783)
T KOG1008|consen  249 LAYCPTR  255 (783)
T ss_pred             EEeccCC
Confidence            6665543


No 369
>KOG4640 consensus Anaphase-promoting complex (APC), subunit 4 [Cell cycle control, cell division, chromosome partitioning; Posttranslational modification, protein turnover, chaperones]
Probab=65.25  E-value=19  Score=48.27  Aligned_cols=78  Identities=12%  Similarity=0.163  Sum_probs=57.9

Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcccceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      ..|.-+-++|.=..||.+..+|-|-+-.++-      +.+.+..-|.-.|. +++|.| ||++||. |+  .||+|+|-|
T Consensus        21 ~~i~~~ewnP~~dLiA~~t~~gelli~R~n~------qRlwtip~p~~~v~~sL~W~~-DGkllaV-g~--kdG~I~L~D   90 (665)
T KOG4640|consen   21 INIKRIEWNPKMDLIATRTEKGELLIHRLNW------QRLWTIPIPGENVTASLCWRP-DGKLLAV-GF--KDGTIRLHD   90 (665)
T ss_pred             cceEEEEEcCccchhheeccCCcEEEEEecc------ceeEeccCCCCccceeeeecC-CCCEEEE-Ee--cCCeEEEEE
Confidence            3478889999999999999999886665552      23444443444555 899999 9999997 44  789999999


Q ss_pred             CCCCCCCceEE
Q 000080         2351 TLAPPTSSRAS 2361 (2389)
Q Consensus      2351 ~l~~tg~~v~s 2361 (2389)
                      +  ..+..++.
T Consensus        91 v--e~~~~l~~   99 (665)
T KOG4640|consen   91 V--EKGGRLVS   99 (665)
T ss_pred             c--cCCCceec
Confidence            8  34555544


No 370
>PF00930 DPPIV_N:  Dipeptidyl peptidase IV (DPP IV) N-terminal region;  InterPro: IPR002469 In the MEROPS database peptidases and peptidase homologues are grouped into clans and families. Clans are groups of families for which there is evidence of common ancestry based on a common structural fold:  Each clan is identified with two letters, the first representing the catalytic type of the families included in the clan (with the letter 'P' being used for a clan containing families of more than one of the catalytic types serine, threonine and cysteine). Some families cannot yet be assigned to clans, and when a formal assignment is required, such a family is described as belonging to clan A-, C-, M-, N-, S-, T- or U-, according to the catalytic type. Some clans are divided into subclans because there is evidence of a very ancient divergence within the clan, for example MA(E), the gluzincins, and MA(M), the metzincins. Peptidase families are grouped by their catalytic type, the first character representing the catalytic type: A, aspartic; C, cysteine; G, glutamic acid; M, metallo; N, asparagine; S, serine; T, threonine; and U, unknown. The serine, threonine and cysteine peptidases utilise the amino acid as a nucleophile and form an acyl intermediate - these peptidases can also readily act as transferases. In the case of aspartic, glutamic and metallopeptidases, the nucleophile is an activated water molecule. In the case of the asparagine endopeptidases, the nucleophile is asparagine and all are self-processing endopeptidases.   In many instances the structural protein fold that characterises the clan or family may have lost its catalytic activity, yet retain its function in protein recognition and binding.  Proteolytic enzymes that exploit serine in their catalytic activity are ubiquitous, being found in viruses, bacteria and eukaryotes []. They include a wide range of peptidase activity, including exopeptidase, endopeptidase, oligopeptidase and omega-peptidase activity. Over 20 families (denoted S1 - S66) of serine protease have been identified, these being grouped into clans on the basis of structural similarity and other functional evidence []. Structures are known for members of the clans and the structures indicate that some appear to be totally unrelated, suggesting different evolutionary origins for the serine peptidases []. Not withstanding their different evolutionary origins, there are similarities in the reaction mechanisms of several peptidases. Chymotrypsin, subtilisin and carboxypeptidase C have a catalytic triad of serine, aspartate and histidine in common: serine acts as a nucleophile, aspartate as an electrophile, and histidine as a base []. The geometric orientations of the catalytic residues are similar between families, despite different protein folds []. The linear arrangements of the catalytic residues commonly reflect clan relationships. For example the catalytic triad in the chymotrypsin clan (PA) is ordered HDS, but is ordered DHS in the subtilisin clan (SB) and SDH in the carboxypeptidase clan (SC) [, ]. This domain defines serine peptidases belonging to MEROPS peptidase family S9 (clan SC), subfamily S9B (dipeptidyl-peptidase IV). The protein fold of the peptidase domain for members of this family resembles that of serine carboxypeptidase D, the type example of clan SC. This domain is an alignment of the region to the N-terminal side of the active site, which is found in IPR001375 from INTERPRO. CD26 (3.4.14.5 from EC) is also called adenosine deaminase-binding protein (ADA-binding protein) or dipeptidylpeptidase IV (DPP IV ectoenzyme). The exopeptidase cleaves off N-terminal X-Pro or X-Ala dipeptides from polypeptides (dipeptidyl peptidase IV activity). CD26 serves as the costimulatory molecule in T cell activation and is an associated marker of autoimmune diseases, adenosine deaminase-deficiency and HIV pathogenesis.  Dipeptidyl peptidase IV (DPP IV) is responsible for the removal of N-terminal dipeptides sequentially from polypeptides having unsubstituted N termini, provided that the penultimate residue is proline. The enzyme catalyses the reaction: Dipeptidyl-Polypeptide + H(2)O = Dipeptide + Polypeptide  It is a type II membrane protein that forms a homodimer.  CD molecules are leucocyte antigens on cell surfaces. CD antigens nomenclature is updated at Protein Reviews On The Web (http://prow.nci.nih.gov/). ; GO: 0006508 proteolysis, 0016020 membrane; PDB: 2RIP_A 3Q8W_B 2AJL_I 1TKR_B 1TK3_B 3C45_A 2G5P_A 3G0C_D 1R9M_C 1RWQ_A ....
Probab=65.12  E-value=50  Score=41.41  Aligned_cols=155  Identities=8%  Similarity=0.021  Sum_probs=90.8

Q ss_pred             eEEEEEEcCCCC-eEE-EEeCC---CcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEEC-CCCCEEE-EEeCCC
Q 000080         2221 STRAFSSHPLRP-FFL-VGSSN---THIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFD-HYGHRFA-SAALDG 2293 (2389)
Q Consensus      2221 ~VrsVAFsPdG~-~LA-SGS~D---gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFS-PDG~~LA-SgS~Dg 2293 (2389)
                      .+..+.|.++++ +++ .-+.+   ..+.+.|..+|++...++...      .|-...-....|. ++|..++ ....||
T Consensus       185 yl~~v~W~~d~~~l~~~~~nR~q~~~~l~~~d~~tg~~~~~~~e~~------~~Wv~~~~~~~~~~~~~~~~l~~s~~~G  258 (353)
T PF00930_consen  185 YLTRVGWSPDGKRLWVQWLNRDQNRLDLVLCDASTGETRVVLEETS------DGWVDVYDPPHFLGPDGNEFLWISERDG  258 (353)
T ss_dssp             EEEEEEEEETTEEEEEEEEETTSTEEEEEEEEECTTTCEEEEEEES------SSSSSSSSEEEE-TTTSSEEEEEEETTS
T ss_pred             CcccceecCCCcEEEEEEcccCCCEEEEEEEECCCCceeEEEEecC------CcceeeecccccccCCCCEEEEEEEcCC
Confidence            458899999999 333 33333   346788988887654443211      1222333466665 7776444 444677


Q ss_pred             cEEEeeCCCCCccCcccceeeeecCCCeeE-EEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEE
Q 000080         2294 TVCTWQLEVGGRSNVRPMESCLCFSSHAMD-VSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLF 2372 (2389)
Q Consensus      2294 TVkLWDl~tggrs~~k~l~tl~gHs~~V~s-VAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~sv 2372 (2389)
                      --.|+-+...+    .....++...-.|.+ +.+.+ +++.|.-.+....-..-.||-+....+..+++|.+..+.-..+
T Consensus       259 ~~hly~~~~~~----~~~~~lT~G~~~V~~i~~~d~-~~~~iyf~a~~~~p~~r~lY~v~~~~~~~~~~LT~~~~~~~~~  333 (353)
T PF00930_consen  259 YRHLYLYDLDG----GKPRQLTSGDWEVTSILGWDE-DNNRIYFTANGDNPGERHLYRVSLDSGGEPKCLTCEDGDHYSA  333 (353)
T ss_dssp             SEEEEEEETTS----SEEEESS-SSS-EEEEEEEEC-TSSEEEEEESSGGTTSBEEEEEETTETTEEEESSTTSSTTEEE
T ss_pred             CcEEEEEcccc----cceeccccCceeecccceEcC-CCCEEEEEecCCCCCceEEEEEEeCCCCCeEeccCCCCCceEE
Confidence            77777555432    123345545566755 66777 5555543321112235567776433255678888777666899


Q ss_pred             eecccchhhhcccc
Q 000080         2373 LPLKLLNFALSKCR 2386 (2389)
Q Consensus      2373 A~~~~~~~~~s~~~ 2386 (2389)
                      ++||+|++++-.|.
T Consensus       334 ~~Spdg~y~v~~~s  347 (353)
T PF00930_consen  334 SFSPDGKYYVDTYS  347 (353)
T ss_dssp             EE-TTSSEEEEEEE
T ss_pred             EECCCCCEEEEEEc
Confidence            99999999998875


No 371
>COG3386 Gluconolactonase [Carbohydrate transport and metabolism]
Probab=61.13  E-value=1.4e+02  Score=37.75  Aligned_cols=135  Identities=13%  Similarity=0.033  Sum_probs=72.9

Q ss_pred             EEEEEcCCCCeEEEEeC-----------CCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeC
Q 000080         2223 RAFSSHPLRPFFLVGSS-----------NTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~-----------DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
                      ..+..+|+|.+.++...           -|.|+-.|. .|..++-+.   +       |...=+.|+|||||++|-.+..
T Consensus       114 ND~~v~pdG~~wfgt~~~~~~~~~~~~~~G~lyr~~p-~g~~~~l~~---~-------~~~~~NGla~SpDg~tly~aDT  182 (307)
T COG3386         114 NDGVVDPDGRIWFGDMGYFDLGKSEERPTGSLYRVDP-DGGVVRLLD---D-------DLTIPNGLAFSPDGKTLYVADT  182 (307)
T ss_pred             CceeEcCCCCEEEeCCCccccCccccCCcceEEEEcC-CCCEEEeec---C-------cEEecCceEECCCCCEEEEEeC
Confidence            44579999998887554           122333332 344333221   1       2233477999999987777766


Q ss_pred             C-CcEEEeeCC-CCCc-cCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080         2292 D-GTVCTWQLE-VGGR-SNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus      2292 D-gTVkLWDl~-tggr-s~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
                      . +.|.-+++. ..+. .+.+...-...+.+..-.++.-. +|.+-+++.  ...+-|..|+.   +++.++.+.-....
T Consensus       183 ~~~~i~r~~~d~~~g~~~~~~~~~~~~~~~G~PDG~~vDa-dG~lw~~a~--~~g~~v~~~~p---dG~l~~~i~lP~~~  256 (307)
T COG3386         183 PANRIHRYDLDPATGPIGGRRGFVDFDEEPGLPDGMAVDA-DGNLWVAAV--WGGGRVVRFNP---DGKLLGEIKLPVKR  256 (307)
T ss_pred             CCCeEEEEecCcccCccCCcceEEEccCCCCCCCceEEeC-CCCEEEecc--cCCceEEEECC---CCcEEEEEECCCCC
Confidence            4 777777665 2111 01111222222334444566665 777665432  12236777774   56666666655455


Q ss_pred             EEEEee
Q 000080         2369 YDLFLP 2374 (2389)
Q Consensus      2369 V~svA~ 2374 (2389)
                      ++++++
T Consensus       257 ~t~~~F  262 (307)
T COG3386         257 PTNPAF  262 (307)
T ss_pred             CccceE
Confidence            554444


No 372
>PF08596 Lgl_C:  Lethal giant larvae(Lgl) like, C-terminal;  InterPro: IPR013905  The Lethal giant larvae (Lgl) tumour suppressor protein is conserved from yeast to mammals. The Lgl protein functions in cell polarity, at least in part, by regulating SNARE-mediated membrane delivery events at the cell surface []. The N-terminal half of Lgl members contains WD40 repeats (see IPR001680 from INTERPRO), while the C-terminal half appears specific to the protein []. ; PDB: 2OAJ_A.
Probab=60.41  E-value=1.1e+02  Score=39.81  Aligned_cols=147  Identities=19%  Similarity=0.264  Sum_probs=79.3

Q ss_pred             ceeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceee------Eec----cc-----C------CCCCC-----------
Q 000080         2219 NISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATA------TYG----VL-----P------AANVP----------- 2266 (2389)
Q Consensus      2219 ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~------Tl~----vl-----~------gh~~p----------- 2266 (2389)
                      |+.|..|+|.++...||.|-..|.|-||-++..+.-.      .+.    .+     +      -|..+           
T Consensus         1 ~~~v~~vs~a~~t~Elav~~~~GeVv~~k~~~n~~~~~~~~~~~~~~~~~~~~~~~~~~~l~di~~r~~~~~~~gf~P~~   80 (395)
T PF08596_consen    1 NVSVTHVSFAPETLELAVGLESGEVVLFKFGKNQNYGNREQPPDLDYNFRRFSLNNSPGKLTDISDRAPPSLKEGFLPLT   80 (395)
T ss_dssp             ---EEEEEEETTTTEEEEEETTS-EEEEEEEE------------------S--GGGSS-SEEE-GGG--TT-SEEEEEEE
T ss_pred             CceEEEEEecCCCceEEEEccCCcEEEEEcccCCCCCccCCCcccCcccccccccCCCcceEEehhhCCcccccccCchh
Confidence            4678999999999999999999999999886443211      000    00     0      00000           


Q ss_pred             --CCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccccee--eee------cCCCeeEEEEe----cCCC-
Q 000080         2267 --PPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRPMES--CLC------FSSHAMDVSYI----TSSG- 2331 (2389)
Q Consensus      2267 --~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~l~t--l~g------Hs~~V~sVAFS----P~DG- 2331 (2389)
                        .. ..+.|++++.|-=| ++|.|..||++.+-|++..     ..+++  +..      .+..|.++.|+    -+|+ 
T Consensus        81 l~~~-~~g~vtal~~S~iG-Fvaigy~~G~l~viD~RGP-----avI~~~~i~~~~~~~~~~~~vt~ieF~vm~~~~D~y  153 (395)
T PF08596_consen   81 LLDA-KQGPVTALKNSDIG-FVAIGYESGSLVVIDLRGP-----AVIYNENIRESFLSKSSSSYVTSIEFSVMTLGGDGY  153 (395)
T ss_dssp             EE----S-SEEEEEE-BTS-EEEEEETTSEEEEEETTTT-----EEEEEEEGGG--T-SS----EEEEEEEEEE-TTSSS
T ss_pred             heec-cCCcEeEEecCCCc-EEEEEecCCcEEEEECCCC-----eEEeeccccccccccccccCeeEEEEEEEecCCCcc
Confidence              12 24789999998556 9999999999999999743     22222  111      23456677776    2233 


Q ss_pred             --CEEEEeecCCCCCeEEEeeCCC-CCCCceEEEE----eecCcEEEEeec
Q 000080         2332 --SVIAAAGHSSNGINVVVWDTLA-PPTSSRASIT----CHEGLYDLFLPL 2375 (2389)
Q Consensus      2332 --slLASAG~sS~D~TVrLWD~l~-~tg~~v~sL~----GH~~~V~svA~~ 2375 (2389)
                        -+|.. |  .+.|++.++.++- +.+.....+.    .|.+.|..+.+.
T Consensus       154 SSi~L~v-G--Tn~G~v~~fkIlp~~~g~f~v~~~~~~~~~~~~i~~I~~i  201 (395)
T PF08596_consen  154 SSICLLV-G--TNSGNVLTFKILPSSNGRFSVQFAGATTNHDSPILSIIPI  201 (395)
T ss_dssp             EEEEEEE-E--ETTSEEEEEEEEE-GGG-EEEEEEEEE--SS----EEEEE
T ss_pred             cceEEEE-E--eCCCCEEEEEEecCCCCceEEEEeeccccCCCceEEEEEE
Confidence              24443 4  4669999998852 2222222332    355777777765


No 373
>PF04053 Coatomer_WDAD:  Coatomer WD associated region ;  InterPro: IPR006692 Proteins synthesised on the ribosome and processed in the endoplasmic reticulum are transported from the Golgi apparatus to the trans-Golgi network (TGN), and from there via small carrier vesicles to their final destination compartment. This traffic is bidirectional, to ensure that proteins required to form vesicles are recycled. Vesicles have specific coat proteins (such as clathrin or coatomer) that are important for cargo selection and direction of transfer []. While clathrin mediates endocytic protein transport, and transport from ER to Golgi, coatomers primarily mediate intra-Golgi transport, as well as the reverse Golgi to ER transport of dilysine-tagged proteins []. For example, the coatomer COP1 (coat protein complex 1) is responsible for reverse transport of recycled proteins from Golgi and pre-Golgi compartments back to the ER, while COPII buds vesicles from the ER to the Golgi []. Coatomers reversibly associate with Golgi (non-clathrin-coated) vesicles to mediate protein transport and for budding from Golgi membranes []. Activated small guanine triphosphatases (GTPases) attract coat proteins to specific membrane export sites, thereby linking coatomers to export cargos. As coat proteins polymerise, vesicles are formed and budded from membrane-bound organelles. Coatomer complexes also influence Golgi structural integrity, as well as the processing, activity, and endocytic recycling of LDL receptors. In mammals, coatomer complexes can only be recruited by membranes associated to ADP-ribosylation factors (ARFs), which are small GTP-binding proteins. Coatomer complexes are hetero-oligomers composed of at least an alpha, beta, beta', gamma, delta, epsilon and zeta subunits.  This entry represents the WD-associated region found in coatomer subunits alpha, beta and beta' subunits. The alpha-subunit (RET1P) of the coatomer complex in Saccharomyces cerevisiae (Baker's yeast), participates in membrane transport between the endoplasmic reticulum and Golgi apparatus. The protein contains six WD-40 repeat motifs in its N-terminal region []. More information about these proteins can be found at Protein of the Month: Clathrin [].; GO: 0005198 structural molecule activity, 0006886 intracellular protein transport, 0016192 vesicle-mediated transport, 0030117 membrane coat; PDB: 3MKQ_B.
Probab=59.08  E-value=51  Score=43.28  Aligned_cols=99  Identities=17%  Similarity=0.290  Sum_probs=54.5

Q ss_pred             EEEEcCCCCeEEEEeCCCcEEEe-ecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC
Q 000080         2224 AFSSHPLRPFFLVGSSNTHIYLW-EFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2224 sVAFsPdG~~LASGS~DgTIRLW-Dl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t 2302 (2389)
                      ..+|++.++ +|.-...++|+++ ++ +.+.+..++.        +   ..+..|-.   |..|+..+.+ .|.+||+++
T Consensus        73 ~~vw~~~n~-yAv~~~~~~I~I~kn~-~~~~~k~i~~--------~---~~~~~If~---G~LL~~~~~~-~i~~yDw~~  135 (443)
T PF04053_consen   73 SFVWSSRNR-YAVLESSSTIKIYKNF-KNEVVKSIKL--------P---FSVEKIFG---GNLLGVKSSD-FICFYDWET  135 (443)
T ss_dssp             EEEE-TSSE-EEEE-TTS-EEEEETT-EE-TT-------------S---S-EEEEE----SSSEEEEETT-EEEEE-TTT
T ss_pred             EEEEecCcc-EEEEECCCeEEEEEcC-ccccceEEcC--------C---cccceEEc---CcEEEEECCC-CEEEEEhhH
Confidence            456777554 4444457778885 44 2222233321        1   12444444   8888888776 899999998


Q ss_pred             CCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2303 GGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2303 ggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      +     +.+.....  ..|..|.|++ +|+++|-.    .+.++.|.+.
T Consensus       136 ~-----~~i~~i~v--~~vk~V~Ws~-~g~~val~----t~~~i~il~~  172 (443)
T PF04053_consen  136 G-----KLIRRIDV--SAVKYVIWSD-DGELVALV----TKDSIYILKY  172 (443)
T ss_dssp             -------EEEEESS---E-EEEEE-T-TSSEEEEE-----S-SEEEEEE
T ss_pred             c-----ceeeEEec--CCCcEEEEEC-CCCEEEEE----eCCeEEEEEe
Confidence            6     35555542  2378999999 89999986    3557888886


No 374
>smart00299 CLH Clathrin heavy chain repeat homology.
Probab=58.29  E-value=22  Score=38.41  Aligned_cols=60  Identities=18%  Similarity=0.180  Sum_probs=43.9

Q ss_pred             hhHHhHhhc---ccChHHHHHHHHhhHHHHhhcchhHHHHHHHHh--cCChhHHHHHHHHhcCChhhhhhhhhh
Q 000080         1293 KPLVGFLSR---NFQEEKNKAAALKNAYVLLGRHQLELAIAFFLL--GGDAASAVTVCARNLGDVQLALVICRL 1361 (2389)
Q Consensus      1293 ~~m~~FLsn---DFse~RWr~AAlKNAyaLLsK~Ry~~AAAFFLL--Ag~lkDAV~Vc~~~L~D~qLAi~IaRL 1361 (2389)
                      .++.+||.+   .|+-+        .|..+..++++. .+++||+  .|..++||++++++++|+++|+-.|+-
T Consensus        57 ~~ll~~l~~~~~~yd~~--------~~~~~c~~~~l~-~~~~~l~~k~~~~~~Al~~~l~~~~d~~~a~~~~~~  121 (140)
T smart00299       57 QKEIERLDNKSNHYDIE--------KVGKLCEKAKLY-EEAVELYKKDGNFKDAIVTLIEHLGNYEKAIEYFVK  121 (140)
T ss_pred             HHHHHHHHhccccCCHH--------HHHHHHHHcCcH-HHHHHHHHhhcCHHHHHHHHHHcccCHHHHHHHHHh
Confidence            457888883   44433        466777777664 3444444  367899999999999999999988875


No 375
>TIGR02604 Piru_Ver_Nterm putative membrane-bound dehydrogenase domain. All proteins that score above the trusted cutoff score of 45 to this model are large proteins of either Pirellula sp. 1 or Verrucomicrobium spinosum. These proteins all contain, in addition to this domain, several hundred residues of highly variable sequence, and then a well-conserved C-terminal domain (TIGR02603) that features a putative cytochrome c-type heme binding motif CXXCH. The membrane-bound L-sorbosone dehydrogenase from Acetobacter liquefaciens (Gluconacetobacter liquefaciens) is homologous to this domain but lacks additional sequence regions shared by members of this family and belongs to a different clade of the larger family of homologs. It and its closely related homologs are excluded from the this model by scoring between the trusted (45) and noise (18) cutoffs.
Probab=58.23  E-value=80  Score=40.01  Aligned_cols=101  Identities=11%  Similarity=0.138  Sum_probs=55.1

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCC-C----ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-----
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGK-D----KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD----- 2292 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~t-G----k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D----- 2292 (2389)
                      +.+++.++| ++++ +.+.-.++.|... +    +....+..++...   ..+......++|.|||+..++-+..     
T Consensus        75 ~Gi~~~~~G-lyV~-~~~~i~~~~d~~gdg~ad~~~~~l~~~~~~~~---~~~~~~~~~l~~gpDG~LYv~~G~~~~~~~  149 (367)
T TIGR02604        75 TGLAVAVGG-VYVA-TPPDILFLRDKDGDDKADGEREVLLSGFGGQI---NNHHHSLNSLAWGPDGWLYFNHGNTLASKV  149 (367)
T ss_pred             cceeEecCC-EEEe-CCCeEEEEeCCCCCCCCCCccEEEEEccCCCC---CcccccccCceECCCCCEEEecccCCCcee
Confidence            567999999 6664 4454444556532 1    2111122222210   1123568899999999987765521     


Q ss_pred             --------------CcEEEeeCCCCCccCcccceee-eecCCCeeEEEEecCCCCEEEE
Q 000080         2293 --------------GTVCTWQLEVGGRSNVRPMESC-LCFSSHAMDVSYITSSGSVIAA 2336 (2389)
Q Consensus      2293 --------------gTVkLWDl~tggrs~~k~l~tl-~gHs~~V~sVAFSP~DGslLAS 2336 (2389)
                                    |.|.-.|..++      .+..+ .|+ ...+.++|+| +|+++++
T Consensus       150 ~~~~~~~~~~~~~~g~i~r~~pdg~------~~e~~a~G~-rnp~Gl~~d~-~G~l~~t  200 (367)
T TIGR02604       150 TRPGTSDESRQGLGGGLFRYNPDGG------KLRVVAHGF-QNPYGHSVDS-WGDVFFC  200 (367)
T ss_pred             ccCCCccCcccccCceEEEEecCCC------eEEEEecCc-CCCccceECC-CCCEEEE
Confidence                          33333344332      11121 233 3346899999 8999876


No 376
>COG3490 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=57.97  E-value=87  Score=39.27  Aligned_cols=102  Identities=12%  Similarity=0.145  Sum_probs=70.3

Q ss_pred             EEEEEcCCCCe-EEEEeCCCc-EEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCC-----CcE
Q 000080         2223 RAFSSHPLRPF-FLVGSSNTH-IYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALD-----GTV 2295 (2389)
Q Consensus      2223 rsVAFsPdG~~-LASGS~DgT-IRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~D-----gTV 2295 (2389)
                      ..|+|||..+. ++-+-.=|| ..++|..++++..++...++-  ..-||  .    .|||||.+|-..-.|     |.|
T Consensus        71 Hgi~~~p~~~ravafARrPGtf~~vfD~~~~~~pv~~~s~~~R--HfyGH--G----vfs~dG~~LYATEndfd~~rGVi  142 (366)
T COG3490          71 HGIAFHPALPRAVAFARRPGTFAMVFDPNGAQEPVTLVSQEGR--HFYGH--G----VFSPDGRLLYATENDFDPNRGVI  142 (366)
T ss_pred             CCeecCCCCcceEEEEecCCceEEEECCCCCcCcEEEecccCc--eeecc--c----ccCCCCcEEEeecCCCCCCCceE
Confidence            44589998774 555555555 589999888877776321111  11233  2    499999988877665     889


Q ss_pred             EEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEe
Q 000080         2296 CTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAA 2337 (2389)
Q Consensus      2296 kLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASA 2337 (2389)
                      -++|.+.+    .+.+-.+..|.-.--+|.+.+ ||++|+.+
T Consensus       143 GvYd~r~~----fqrvgE~~t~GiGpHev~lm~-DGrtlvva  179 (366)
T COG3490         143 GVYDAREG----FQRVGEFSTHGIGPHEVTLMA-DGRTLVVA  179 (366)
T ss_pred             EEEecccc----cceecccccCCcCcceeEEec-CCcEEEEe
Confidence            99999853    134455666766666899999 99999976


No 377
>PF14870 PSII_BNR:  Photosynthesis system II assembly factor YCF48; PDB: 2XBG_A.
Probab=56.72  E-value=1.3e+02  Score=37.80  Aligned_cols=105  Identities=18%  Similarity=0.240  Sum_probs=55.3

Q ss_pred             CCeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEec--ccceEEEEeecCCCCeEEEEecceEEee-
Q 000080           95 LPVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILV--QGTKVEAIEWTGSGDGIVAGGMETVLWK-  171 (2389)
Q Consensus        95 ~dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~--hssTV~sIAWSpdG~rLaSggdDV~IW~-  171 (2389)
                      .+|..+.|.|+   ++-++++-++.|+.=...    .....|.....-.  ..-.+-+++|.+++.-.|+||.+..+-. 
T Consensus       187 ~riq~~gf~~~---~~lw~~~~Gg~~~~s~~~----~~~~~w~~~~~~~~~~~~~~ld~a~~~~~~~wa~gg~G~l~~S~  259 (302)
T PF14870_consen  187 RRIQSMGFSPD---GNLWMLARGGQIQFSDDP----DDGETWSEPIIPIKTNGYGILDLAYRPPNEIWAVGGSGTLLVST  259 (302)
T ss_dssp             S-EEEEEE-TT---S-EEEEETTTEEEEEE-T----TEEEEE---B-TTSS--S-EEEEEESSSS-EEEEESTT-EEEES
T ss_pred             ceehhceecCC---CCEEEEeCCcEEEEccCC----CCccccccccCCcccCceeeEEEEecCCCCEEEEeCCccEEEeC
Confidence            58999999997   555566666666655411    0122566632221  2335899999999998898888733332 


Q ss_pred             ccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec
Q 000080          172 KKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS  207 (2389)
Q Consensus       172 ~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~  207 (2389)
                      .+...|+..=. -...|.++|.+.+..+.+ ||-+..
T Consensus       260 DgGktW~~~~~-~~~~~~n~~~i~f~~~~~gf~lG~~  295 (302)
T PF14870_consen  260 DGGKTWQKDRV-GENVPSNLYRIVFVNPDKGFVLGQD  295 (302)
T ss_dssp             STTSS-EE-GG-GTTSSS---EEEEEETTEEEEE-ST
T ss_pred             CCCccceECcc-ccCCCCceEEEEEcCCCceEEECCC
Confidence            46677996510 113466899888877666 775533


No 378
>KOG0882 consensus Cyclophilin-related peptidyl-prolyl cis-trans isomerase [Posttranslational modification, protein turnover, chaperones]
Probab=56.17  E-value=39  Score=43.95  Aligned_cols=117  Identities=12%  Similarity=0.115  Sum_probs=78.1

Q ss_pred             eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCC-C----CccC
Q 000080         2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEV-G----GRSN 2307 (2389)
Q Consensus      2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~t-g----grs~ 2307 (2389)
                      +-++.-.++.|-+.|-.-+-|-..+.  .      .-|.++|..+.++|-|+.+.|....|.|.-|..+- -    ++.+
T Consensus       114 IAVs~~~sg~i~VvD~~~d~~q~~~f--k------klH~sPV~~i~y~qa~Ds~vSiD~~gmVEyWs~e~~~qfPr~~l~  185 (558)
T KOG0882|consen  114 IAVSLFKSGKIFVVDGFGDFCQDGYF--K------KLHFSPVKKIRYNQAGDSAVSIDISGMVEYWSAEGPFQFPRTNLN  185 (558)
T ss_pred             EEeecccCCCcEEECCcCCcCcccee--c------ccccCceEEEEeeccccceeeccccceeEeecCCCcccCcccccc
Confidence            34444588999999965444433321  1      13779999999999999999999999999998762 0    0000


Q ss_pred             --cc---cceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2308 --VR---PMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2308 --~k---~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                        ++   -+....---+...++.|+| +|..+++-   +.|+.||+.++  -+++.++-++
T Consensus       186 ~~~K~eTdLy~f~K~Kt~pts~Efsp-~g~qistl---~~DrkVR~F~~--KtGklvqeiD  240 (558)
T KOG0882|consen  186 FELKHETDLYGFPKAKTEPTSFEFSP-DGAQISTL---NPDRKVRGFVF--KTGKLVQEID  240 (558)
T ss_pred             ccccccchhhcccccccCccceEEcc-ccCccccc---CcccEEEEEEe--ccchhhhhhh
Confidence              00   0111111113455899999 99999985   59999999997  3555555443


No 379
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=52.72  E-value=92  Score=39.52  Aligned_cols=105  Identities=9%  Similarity=-0.041  Sum_probs=62.1

Q ss_pred             CCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc
Q 000080         2231 RPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP 2310 (2389)
Q Consensus      2231 G~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~ 2310 (2389)
                      +..+..++.|+.+...|..+|+.+-+.. +        +   ....+  ..+|.++-.++.||.|...|.++|.     .
T Consensus       256 ~~~vy~~~~~g~l~ald~~tG~~~W~~~-~--------~---~~~~~--~~~~~~vy~~~~~g~l~ald~~tG~-----~  316 (394)
T PRK11138        256 GGVVYALAYNGNLVALDLRSGQIVWKRE-Y--------G---SVNDF--AVDGGRIYLVDQNDRVYALDTRGGV-----E  316 (394)
T ss_pred             CCEEEEEEcCCeEEEEECCCCCEEEeec-C--------C---CccCc--EEECCEEEEEcCCCeEEEEECCCCc-----E
Confidence            4456667789999999999998765542 1        0   01111  2356677777888889888888763     1


Q ss_pred             ceeee--ecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEE
Q 000080         2311 MESCL--CFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASIT 2363 (2389)
Q Consensus      2311 l~tl~--gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~ 2363 (2389)
                      +....  .+ ....+.+..  +|.+++.    +.|+.|...|.  .+|+.+....
T Consensus       317 ~W~~~~~~~-~~~~sp~v~--~g~l~v~----~~~G~l~~ld~--~tG~~~~~~~  362 (394)
T PRK11138        317 LWSQSDLLH-RLLTAPVLY--NGYLVVG----DSEGYLHWINR--EDGRFVAQQK  362 (394)
T ss_pred             EEcccccCC-CcccCCEEE--CCEEEEE----eCCCEEEEEEC--CCCCEEEEEE
Confidence            21111  11 111122222  4555543    47889998886  5677666554


No 380
>PF03178 CPSF_A:  CPSF A subunit region;  InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=52.50  E-value=98  Score=38.17  Aligned_cols=112  Identities=10%  Similarity=0.095  Sum_probs=67.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCc-eeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDK-ATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk-~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +|.+|+-- +|. |+.| .++.|++|++...+ .+..-. ...        ...|.++  +..+++++.|+.-+.|.+..
T Consensus        90 ~V~ai~~~-~~~-lv~~-~g~~l~v~~l~~~~~l~~~~~-~~~--------~~~i~sl--~~~~~~I~vgD~~~sv~~~~  155 (321)
T PF03178_consen   90 PVTAICSF-NGR-LVVA-VGNKLYVYDLDNSKTLLKKAF-YDS--------PFYITSL--SVFKNYILVGDAMKSVSLLR  155 (321)
T ss_dssp             -EEEEEEE-TTE-EEEE-ETTEEEEEEEETTSSEEEEEE-E-B--------SSSEEEE--EEETTEEEEEESSSSEEEEE
T ss_pred             cceEhhhh-CCE-EEEe-ecCEEEEEEccCcccchhhhe-ecc--------eEEEEEE--eccccEEEEEEcccCEEEEE
Confidence            35666655 444 4443 45899999998887 443321 111        1234444  44477999999999999886


Q ss_pred             CCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCC
Q 000080         2300 LEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTL 2352 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l 2352 (2389)
                      .....+ ....+. -......+.++.|.+ |++.++.+   ..+++|.++...
T Consensus       156 ~~~~~~-~l~~va-~d~~~~~v~~~~~l~-d~~~~i~~---D~~gnl~~l~~~  202 (321)
T PF03178_consen  156 YDEENN-KLILVA-RDYQPRWVTAAEFLV-DEDTIIVG---DKDGNLFVLRYN  202 (321)
T ss_dssp             EETTTE--EEEEE-EESS-BEEEEEEEE--SSSEEEEE---ETTSEEEEEEE-
T ss_pred             EEccCC-EEEEEE-ecCCCccEEEEEEec-CCcEEEEE---cCCCeEEEEEEC
Confidence            654221 111211 122356688999997 55566554   488999999973


No 381
>PF10313 DUF2415:  Uncharacterised protein domain (DUF2415);  InterPro: IPR019417  This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif. 
Probab=52.23  E-value=29  Score=32.19  Aligned_cols=30  Identities=20%  Similarity=0.222  Sum_probs=26.3

Q ss_pred             CEEEEEECCC-C--CEEEEEeCCCcEEEeeCCC
Q 000080         2273 SISALQFDHY-G--HRFASAALDGTVCTWQLEV 2302 (2389)
Q Consensus      2273 ~V~sVaFSPD-G--~~LASgS~DgTVkLWDl~t 2302 (2389)
                      .|++++|||+ |  +.||-+-.-|.|.|+|+++
T Consensus         2 AvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~   34 (43)
T PF10313_consen    2 AVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRS   34 (43)
T ss_pred             CeEEEEeCCCCCcccEEEEEccCCeEEEEEccc
Confidence            4899999985 4  5999999999999999985


No 382
>PF10168 Nup88:  Nuclear pore component;  InterPro: IPR019321  Nup88 can be divided into two structural domains; the N-terminal two-thirds of the protein have no obvious structural motifs. It is, however, where it binds to Nup98; one of the components of the nuclear pore. The C-terminal end is a predicted coiled-coil domain []. Nup88 is over expressed in tumour cells []. 
Probab=51.80  E-value=92  Score=43.38  Aligned_cols=85  Identities=21%  Similarity=0.253  Sum_probs=44.9

Q ss_pred             EEEEeecCCCc-eEeeecc---cc-ccc-CCCC---CCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCC
Q 000080          191 LVSATWSIEGP-SATAASM---SQ-LDL-LGPK---EAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGD  261 (2389)
Q Consensus       191 ivsvaWSpdG~-fATag~d---ik-f~~-~~~~---~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~D  261 (2389)
                      |-.+.-||+|. +|-+|..   +. .+. |+.+   +.++....|..-.-. -.+....+.-.|..|+|||.+-     .
T Consensus        87 v~~i~~n~~g~~lal~G~~~v~V~~LP~r~g~~~~~~~g~~~i~Crt~~v~-~~~~~~~~~~~i~qv~WhP~s~-----~  160 (717)
T PF10168_consen   87 VHQISLNPTGSLLALVGPRGVVVLELPRRWGKNGEFEDGKKEINCRTVPVD-ERFFTSNSSLEIKQVRWHPWSE-----S  160 (717)
T ss_pred             EEEEEECCCCCEEEEEcCCcEEEEEeccccCccccccCCCcceeEEEEEec-hhhccCCCCceEEEEEEcCCCC-----C
Confidence            33556699999 6666662   11 222 3321   122222233211000 0011245668999999999321     1


Q ss_pred             CccccCceEEeeecCCeEEEEEeec
Q 000080          262 TKRSQRHVLLTCCLDGTVRLWCEMD  286 (2389)
Q Consensus       262 gk~~~~nILAScSdDgTVRLW~e~d  286 (2389)
                          ..+ |+-=+.||++|+++..+
T Consensus       161 ----~~~-l~vLtsdn~lR~y~~~~  180 (717)
T PF10168_consen  161 ----DSH-LVVLTSDNTLRLYDISD  180 (717)
T ss_pred             ----CCe-EEEEecCCEEEEEecCC
Confidence                233 33444799999999764


No 383
>PF15390 DUF4613:  Domain of unknown function (DUF4613)
Probab=51.57  E-value=2.4e+02  Score=38.62  Aligned_cols=130  Identities=16%  Similarity=0.305  Sum_probs=78.1

Q ss_pred             EecccceEEEEeecCCCC----eEEEEecc--eEEeec-----cCCcEEEEEEeeccccceEE--EEeecCCCc-eEeee
Q 000080          141 ILVQGTKVEAIEWTGSGD----GIVAGGME--TVLWKK-----KNTLWEIAWKFKENYPQNLV--SATWSIEGP-SATAA  206 (2389)
Q Consensus       141 tL~hssTV~sIAWSpdG~----rLaSggdD--V~IW~~-----~~s~Wecvwt~~~~~~~~iv--svaWSpdG~-fATag  206 (2389)
                      ++.+--.|..++|.|-+.    .|+++--.  |.||+.     ..+.|-+..++....+.++.  ..-|.|... +|.-.
T Consensus        52 viGqFEhV~GlsW~P~~~~~~paLLAVQHkkhVtVWqL~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk~~iL~VLT  131 (671)
T PF15390_consen   52 VIGQFEHVHGLSWAPPCTADTPALLAVQHKKHVTVWQLCPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPKKAILTVLT  131 (671)
T ss_pred             EeeccceeeeeeecCcccCCCCceEEEeccceEEEEEeccCccccccceeeeeeeccCCcccCCCcccccCCCceEEEEe
Confidence            344455789999999853    45555554  889994     45778888777666677777  456999877 55443


Q ss_pred             c-ccc--cccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCCCCccccCceEEeeecCCeEE--E
Q 000080          207 S-MSQ--LDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPGDTKRSQRHVLLTCCLDGTVR--L  281 (2389)
Q Consensus       207 ~-dik--f~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~Dgk~~~~nILAScSdDgTVR--L  281 (2389)
                      + |+.  +.+.             .|  ..-.++..--.+-|.|-.|-+        ||.+     |+-+ ...++.  |
T Consensus       132 ~~dvSV~~sV~-------------~d--~srVkaDi~~~G~IhCACWT~--------DG~R-----LVVA-vGSsLHSyi  182 (671)
T PF15390_consen  132 ARDVSVLPSVH-------------CD--SSRVKADIKTSGLIHCACWTK--------DGQR-----LVVA-VGSSLHSYI  182 (671)
T ss_pred             cCceeEeeeee-------------eC--CceEEEeccCCceEEEEEecC--------cCCE-----EEEE-eCCeEEEEE
Confidence            3 443  1111             01  111223333446788999999        7766     5544 222444  5


Q ss_pred             EEeecCCcccccccccCCCCccceeEEEEEE
Q 000080          282 WCEMDSGKTRKVAKDTNDHKTIRRSFCVGAI  312 (2389)
Q Consensus       282 W~e~d~Gk~kk~~~~~~d~~~~~~sF~vaA~  312 (2389)
                      ||  +..|.           ..+|+||.+--
T Consensus       183 Wd--~~qKt-----------L~~CsfcPVFd  200 (671)
T PF15390_consen  183 WD--SAQKT-----------LHRCSFCPVFD  200 (671)
T ss_pred             ec--Cchhh-----------hhhCCcceeec
Confidence            65  33333           23699997643


No 384
>PF00780 CNH:  CNH domain;  InterPro: IPR001180 Based on sequence similarities a domain of homology has been identified in the following proteins []:  Citron and Citron kinase. These two proteins interact with the GTP-bound forms of the small GTPases Rho and Rac but not with Cdc42. Myotonic dystrophy kinase-related Cdc42-binding kinase (MRCKalpha). This serine/threonine kinase interacts with the GTP-bound form of the small GTPase Cdc42 and to a lesser extent with that of Rac. NCK Interacting Kinase (NIK), a serine/threonine protein kinase. ROM-1 and ROM-2, from yeast. These proteins are GDP/GTP exchange proteins (GEPs) for the small GTP binding protein Rho1.  This domain, called the citron homology domain, is often found after cysteine rich and pleckstrin homology (PH) domains at the C-terminal end of the proteins []. It acts as a regulatory domain and could be involved in macromolecular interactions [, ].; GO: 0005083 small GTPase regulator activity
Probab=51.46  E-value=2.3e+02  Score=33.74  Aligned_cols=128  Identities=14%  Similarity=0.132  Sum_probs=75.8

Q ss_pred             CCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccC
Q 000080         2229 PLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSN 2307 (2389)
Q Consensus      2229 PdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~ 2307 (2389)
                      ..++.|+-|.+|| +.+++..++ +..+...            ...|.++..-|+-+.|+.-++ +++.+.++..-....
T Consensus         5 ~~~~~L~vGt~~G-l~~~~~~~~~~~~~i~~------------~~~I~ql~vl~~~~~llvLsd-~~l~~~~L~~l~~~~   70 (275)
T PF00780_consen    5 SWGDRLLVGTEDG-LYVYDLSDPSKPTRILK------------LSSITQLSVLPELNLLLVLSD-GQLYVYDLDSLEPVS   70 (275)
T ss_pred             cCCCEEEEEECCC-EEEEEecCCccceeEee------------cceEEEEEEecccCEEEEEcC-CccEEEEchhhcccc
Confidence            4578899999999 999999333 3333332            244999999999888887765 999999997642100


Q ss_pred             cc-cc--------eeeeecCCCeeEEE--EecCCCCEEEEeecCCCCCeEEEeeCCCCCC---CceEEEEeecCcEEEEe
Q 000080         2308 VR-PM--------ESCLCFSSHAMDVS--YITSSGSVIAAAGHSSNGINVVVWDTLAPPT---SSRASITCHEGLYDLFL 2373 (2389)
Q Consensus      2308 ~k-~l--------~tl~gHs~~V~sVA--FSP~DGslLASAG~sS~D~TVrLWD~l~~tg---~~v~sL~GH~~~V~svA 2373 (2389)
                      .. +.        .......+.|..++  =.+..+..|+.+    ..++|.||.......   +.++.+. -+..+.+++
T Consensus        71 ~~~~~~~~~~~~~~~~~~~~~~v~~f~~~~~~~~~~~L~va----~kk~i~i~~~~~~~~~f~~~~ke~~-lp~~~~~i~  145 (275)
T PF00780_consen   71 TSAPLAFPKSRSLPTKLPETKGVSFFAVNGGHEGSRRLCVA----VKKKILIYEWNDPRNSFSKLLKEIS-LPDPPSSIA  145 (275)
T ss_pred             ccccccccccccccccccccCCeeEEeeccccccceEEEEE----ECCEEEEEEEECCcccccceeEEEE-cCCCcEEEE
Confidence            00 00        00122334555555  112244566654    577999999843211   2334443 334455555


Q ss_pred             ec
Q 000080         2374 PL 2375 (2389)
Q Consensus      2374 ~~ 2375 (2389)
                      +.
T Consensus       146 ~~  147 (275)
T PF00780_consen  146 FL  147 (275)
T ss_pred             Ee
Confidence            54


No 385
>PF07569 Hira:  TUP1-like enhancer of split;  InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=51.08  E-value=63  Score=38.60  Aligned_cols=73  Identities=15%  Similarity=0.210  Sum_probs=54.0

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCC--------CCCCCEEEEEECCCCCEEEEEeCCCcEE
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPP--------YALASISALQFDHYGHRFASAALDGTVC 2296 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~--------GH~~~V~sVaFSPDG~~LASgS~DgTVk 2296 (2389)
                      +.+..++.+|+.-..+|.+++||+.+++++..-..  -  .|..        .....|.++.++.+|.-+++-+. |...
T Consensus        16 ~~l~~~~~~Ll~iT~~G~l~vWnl~~~k~~~~~~S--i--~pll~~~~~~~~~~~~~i~~~~lt~~G~PiV~lsn-g~~y   90 (219)
T PF07569_consen   16 SFLECNGSYLLAITSSGLLYVWNLKKGKAVLPPVS--I--APLLNSSPVSDKSSSPNITSCSLTSNGVPIVTLSN-GDSY   90 (219)
T ss_pred             EEEEeCCCEEEEEeCCCeEEEEECCCCeeccCCcc--H--HHHhcccccccCCCCCcEEEEEEcCCCCEEEEEeC-CCEE
Confidence            45778899999999999999999999887533200  0  0101        24477999999999988887765 6788


Q ss_pred             EeeCCC
Q 000080         2297 TWQLEV 2302 (2389)
Q Consensus      2297 LWDl~t 2302 (2389)
                      .||..-
T Consensus        91 ~y~~~L   96 (219)
T PF07569_consen   91 SYSPDL   96 (219)
T ss_pred             Eecccc
Confidence            997764


No 386
>PRK13684 Ycf48-like protein; Provisional
Probab=49.55  E-value=1.9e+02  Score=36.45  Aligned_cols=110  Identities=17%  Similarity=0.215  Sum_probs=60.2

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      .+.++.+.|++.+++.|....-.+.+|-+ |+.-....   .      +-...++++++.|+|+.++.| ..|.+++=..
T Consensus       174 ~~~~i~~~~~g~~v~~g~~G~i~~s~~~g-g~tW~~~~---~------~~~~~l~~i~~~~~g~~~~vg-~~G~~~~~s~  242 (334)
T PRK13684        174 VVRNLRRSPDGKYVAVSSRGNFYSTWEPG-QTAWTPHQ---R------NSSRRLQSMGFQPDGNLWMLA-RGGQIRFNDP  242 (334)
T ss_pred             eEEEEEECCCCeEEEEeCCceEEEEcCCC-CCeEEEee---C------CCcccceeeeEcCCCCEEEEe-cCCEEEEccC
Confidence            45888999999888776544333444422 22111111   1      123679999999999877765 4577653212


Q ss_pred             CCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEE
Q 000080         2301 EVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVV 2347 (2389)
Q Consensus      2301 ~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVr 2347 (2389)
                      ..| .+=.........-+..+.+++|.| ++++++.+    .++.|.
T Consensus       243 d~G-~sW~~~~~~~~~~~~~l~~v~~~~-~~~~~~~G----~~G~v~  283 (334)
T PRK13684        243 DDL-ESWSKPIIPEITNGYGYLDLAYRT-PGEIWAGG----GNGTLL  283 (334)
T ss_pred             CCC-CccccccCCccccccceeeEEEcC-CCCEEEEc----CCCeEE
Confidence            222 110000000000123567899998 77888764    456544


No 387
>PF04841 Vps16_N:  Vps16, N-terminal region;  InterPro: IPR006926 This protein forms part of the Class C vacuolar protein sorting (Vps) complex. Vps16 is essential for vacuolar protein sorting, which is essential for viability in plants, but not yeast []. The Class C Vps complex is required for SNARE-mediated membrane fusion at the lysosome-like yeast vacuole. It is thought to play essential roles in membrane docking and fusion at the Golgi-to-endosome and endosome-to-vacuole stages of transport []. The role of VPS16 in this complex is not known.; GO: 0006886 intracellular protein transport, 0005737 cytoplasm
Probab=49.43  E-value=2.8e+02  Score=36.18  Aligned_cols=131  Identities=8%  Similarity=-0.037  Sum_probs=71.6

Q ss_pred             EEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCc
Q 000080         2226 SSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGR 2305 (2389)
Q Consensus      2226 AFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggr 2305 (2389)
                      .++.+....+....+++|.+=+-..-+.   .   +.        .+.+..+++||+|+.+|--..+|++.+....-.  
T Consensus       185 ~l~~~~~~~i~~~~g~~i~~i~~~~~~~---i---~~--------~~~i~~iavSpng~~iAl~t~~g~l~v~ssDf~--  248 (410)
T PF04841_consen  185 LLSSDRVVEILLANGETIYIIDENSFKQ---I---DS--------DGPIIKIAVSPNGKFIALFTDSGNLWVVSSDFS--  248 (410)
T ss_pred             EeecCcceEEEEecCCEEEEEEcccccc---c---cC--------CCCeEEEEECCCCCEEEEEECCCCEEEEECccc--
Confidence            4666666666666666776333211111   1   11        246999999999999999999999888754322  


Q ss_pred             cCcccceeeeec-CCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCcEEEEeecccchhhhcc
Q 000080         2306 SNVRPMESCLCF-SSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGLYDLFLPLKLLNFALSK 2384 (2389)
Q Consensus      2306 s~~k~l~tl~gH-s~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~V~svA~~~~~~~~~s~ 2384 (2389)
                         +.+..+... ......++|-. +...+++     .+..|.|...   .+..+.-....+   ..+.+-.||=++++.
T Consensus       249 ---~~~~e~~~~~~~~p~~~~WCG-~dav~l~-----~~~~l~lvg~---~~~~~~~~~~~~---~~l~~E~DG~riit~  313 (410)
T PF04841_consen  249 ---EKLCEFDTDSKSPPKQMAWCG-NDAVVLS-----WEDELLLVGP---DGDSISFWYDGP---VILVSEIDGVRIITS  313 (410)
T ss_pred             ---ceeEEeecCcCCCCcEEEEEC-CCcEEEE-----eCCEEEEECC---CCCceEEeccCc---eEEeccCCceEEEeC
Confidence               222222222 23344566665 3344443     2345666653   333332211111   336666677777765


Q ss_pred             ccc
Q 000080         2385 CRC 2387 (2389)
Q Consensus      2385 ~~~ 2387 (2389)
                      =.|
T Consensus       314 ~~~  316 (410)
T PF04841_consen  314 TSH  316 (410)
T ss_pred             Cce
Confidence            544


No 388
>TIGR03606 non_repeat_PQQ dehydrogenase, PQQ-dependent, s-GDH family. PQQ, or pyrroloquinoline-quinone, serves as a cofactor for a number of sugar and alcohol dehydrogenases in a limited number of bacterial species. Most characterized PQQ-dependent enzymes have multiple repeats of a sequence region described by pfam01011 (PQQ enzyme repeat), but this protein family in unusual in lacking that repeat. Below the noise cutoff are related proteins mostly from species that lack PQQ biosynthesis.
Probab=47.66  E-value=2.2e+02  Score=37.86  Aligned_cols=110  Identities=9%  Similarity=0.087  Sum_probs=61.5

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCC-------CEEEEEeC----
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYG-------HRFASAAL---- 2291 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG-------~~LASgS~---- 2291 (2389)
                      |+|+|-|||++|++--..|.|++++-.++...... .++.- ....+ ......|+|+||=       ...++-+.    
T Consensus        33 w~maflPDG~llVtER~~G~I~~v~~~~~~~~~~~-~l~~v-~~~~g-e~GLlglal~PdF~~~~~n~~lYvsyt~~~~~  109 (454)
T TIGR03606        33 WALLWGPDNQLWVTERATGKILRVNPETGEVKVVF-TLPEI-VNDAQ-HNGLLGLALHPDFMQEKGNPYVYISYTYKNGD  109 (454)
T ss_pred             eEEEEcCCCeEEEEEecCCEEEEEeCCCCceeeee-cCCce-eccCC-CCceeeEEECCCccccCCCcEEEEEEeccCCC
Confidence            88999999999998665799999986555422111 11110 00012 3668999999984       23444211    


Q ss_pred             -----CCcEEEeeCCCCCc--cCcccce-ee---eecCCCeeEEEEecCCCCEEEEee
Q 000080         2292 -----DGTVCTWQLEVGGR--SNVRPME-SC---LCFSSHAMDVSYITSSGSVIAAAG 2338 (2389)
Q Consensus      2292 -----DgTVkLWDl~tggr--s~~k~l~-tl---~gHs~~V~sVAFSP~DGslLASAG 2338 (2389)
                           ...|.-|.+.....  ...+.+. .+   .+|.+  ..++|.| ||.+.++.|
T Consensus       110 ~~~~~~~~I~R~~l~~~~~~l~~~~~Il~~lP~~~~H~G--grI~FgP-DG~LYVs~G  164 (454)
T TIGR03606       110 KELPNHTKIVRYTYDKSTQTLEKPVDLLAGLPAGNDHNG--GRLVFGP-DGKIYYTIG  164 (454)
T ss_pred             CCccCCcEEEEEEecCCCCccccceEEEecCCCCCCcCC--ceEEECC-CCcEEEEEC
Confidence                 22343344432100  0111121 11   13443  4689999 999999877


No 389
>PRK11138 outer membrane biogenesis protein BamB; Provisional
Probab=47.26  E-value=1.2e+02  Score=38.56  Aligned_cols=99  Identities=11%  Similarity=0.008  Sum_probs=58.3

Q ss_pred             CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCcc
Q 000080         2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLEVGGRSNVR 2309 (2389)
Q Consensus      2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k 2309 (2389)
                      ++..|..++.|+.+...|..+|+.+-....+ .+        ....+.+.  .+.++..++.||.|...|..+|.     
T Consensus       293 ~~~~vy~~~~~g~l~ald~~tG~~~W~~~~~-~~--------~~~~sp~v--~~g~l~v~~~~G~l~~ld~~tG~-----  356 (394)
T PRK11138        293 DGGRIYLVDQNDRVYALDTRGGVELWSQSDL-LH--------RLLTAPVL--YNGYLVVGDSEGYLHWINREDGR-----  356 (394)
T ss_pred             ECCEEEEEcCCCeEEEEECCCCcEEEccccc-CC--------CcccCCEE--ECCEEEEEeCCCEEEEEECCCCC-----
Confidence            4556666789999999999999876443211 11        11111112  25677888999999999999873     


Q ss_pred             cceeeeecCCCee-EEEEecCCCCEEEEeecCCCCCeEEEee
Q 000080         2310 PMESCLCFSSHAM-DVSYITSSGSVIAAAGHSSNGINVVVWD 2350 (2389)
Q Consensus      2310 ~l~tl~gHs~~V~-sVAFSP~DGslLASAG~sS~D~TVrLWD 2350 (2389)
                      .+....-....+. +-++.  +|++++.    +.|++|...+
T Consensus       357 ~~~~~~~~~~~~~s~P~~~--~~~l~v~----t~~G~l~~~~  392 (394)
T PRK11138        357 FVAQQKVDSSGFLSEPVVA--DDKLLIQ----ARDGTVYAIT  392 (394)
T ss_pred             EEEEEEcCCCcceeCCEEE--CCEEEEE----eCCceEEEEe
Confidence            3333221222222 22222  5565554    4788877665


No 390
>PF06977 SdiA-regulated:  SdiA-regulated;  InterPro: IPR009722 This entry represents a conserved region approximately 100 residues long within a number of hypothetical bacterial proteins that may be regulated by SdiA, a member of the LuxR family of transcriptional regulators []. Some proteins contain the IPR001258 from INTERPRO repeat.; PDB: 3QQZ_A.
Probab=47.15  E-value=2.8e+02  Score=34.19  Aligned_cols=116  Identities=11%  Similarity=0.112  Sum_probs=69.2

Q ss_pred             EEEEEEcCCCC-eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeC
Q 000080         2222 TRAFSSHPLRP-FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQL 2300 (2389)
Q Consensus      2222 VrsVAFsPdG~-~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl 2300 (2389)
                      +..|+|+|+.. +++....++.|.-.+. +|+.++++. +.       | .+..-.|++--+|.++++--.++++.+-++
T Consensus        24 ~SGLTy~pd~~tLfaV~d~~~~i~els~-~G~vlr~i~-l~-------g-~~D~EgI~y~g~~~~vl~~Er~~~L~~~~~   93 (248)
T PF06977_consen   24 LSGLTYNPDTGTLFAVQDEPGEIYELSL-DGKVLRRIP-LD-------G-FGDYEGITYLGNGRYVLSEERDQRLYIFTI   93 (248)
T ss_dssp             EEEEEEETTTTEEEEEETTTTEEEEEET-T--EEEEEE--S-------S--SSEEEEEE-STTEEEEEETTTTEEEEEEE
T ss_pred             ccccEEcCCCCeEEEEECCCCEEEEEcC-CCCEEEEEe-CC-------C-CCCceeEEEECCCEEEEEEcCCCcEEEEEE
Confidence            59999999855 6666778888887886 688887764 22       2 256899999877765555546999999998


Q ss_pred             CCCCccC-cccceee-----eecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2301 EVGGRSN-VRPMESC-----LCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2301 ~tggrs~-~k~l~tl-----~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ...++.. ...+..+     ..++.....+||.|..+++++ +   -+..-.+|+.+
T Consensus        94 ~~~~~~~~~~~~~~~~l~~~~~~N~G~EGla~D~~~~~L~v-~---kE~~P~~l~~~  146 (248)
T PF06977_consen   94 DDDTTSLDRADVQKISLGFPNKGNKGFEGLAYDPKTNRLFV-A---KERKPKRLYEV  146 (248)
T ss_dssp             ----TT--EEEEEEEE---S---SS--EEEEEETTTTEEEE-E---EESSSEEEEEE
T ss_pred             eccccccchhhceEEecccccCCCcceEEEEEcCCCCEEEE-E---eCCCChhhEEE
Confidence            4432110 0111111     124566889999995555554 3   36666777776


No 391
>PF15390 DUF4613:  Domain of unknown function (DUF4613)
Probab=46.96  E-value=61  Score=43.69  Aligned_cols=98  Identities=15%  Similarity=0.272  Sum_probs=69.7

Q ss_pred             CccEEEEEeeccccCcce--eEeeceeccCCce----EEEEeEEccCCcEEEEEeecceEEEEEeccCCccccccccccc
Q 000080          802 AVSNVRIWESVCVTELGS--FVLEDTLSFDTNI----VAVNWLTLENGQSLLGVCLQNELKVYAQRHYGGQILLDTKNSL  875 (2389)
Q Consensus       802 ~~s~vsIWD~~~~sgGGs--wvLE~ti~ld~~I----VdLDWtStEDGqhILTVGfg~kVlLYtQlRydytn~~~~~~ll  875 (2389)
                      ..++|++|.. |.++..+  |+.-||-++.+.+    +..=|=-+   .-||||=-...+=++--.|.|...        
T Consensus        80 HkkhVtVWqL-~~s~~e~~K~l~sQtcEi~e~~pvLpQGCVWHPk---~~iL~VLT~~dvSV~~sV~~d~sr--------  147 (671)
T PF15390_consen   80 HKKHVTVWQL-CPSTTERNKLLMSQTCEIREPFPVLPQGCVWHPK---KAILTVLTARDVSVLPSVHCDSSR--------  147 (671)
T ss_pred             ccceEEEEEe-ccCccccccceeeeeeeccCCcccCCCcccccCC---CceEEEEecCceeEeeeeeeCCce--------
Confidence            4678999998 8665555  9999998885422    34445443   569999999999666666777221        


Q ss_pred             ccccceeeccCCCCCccccccccCce-EEEEecCeeEEeeccc
Q 000080          876 KMQNWFCLAFSPTFAAHDFTWGRRAI-AIVVHQSYLSIYSQFL  917 (2389)
Q Consensus       876 ~~~~w~~Id~~~T~hIgDssWVRDGI-LVVGmgnEMhVYSQWl  917 (2389)
                           +-+|....-+|..=+|.+||- |||+-|+-+|-|- |.
T Consensus       148 -----VkaDi~~~G~IhCACWT~DG~RLVVAvGSsLHSyi-Wd  184 (671)
T PF15390_consen  148 -----VKADIKTSGLIHCACWTKDGQRLVVAVGSSLHSYI-WD  184 (671)
T ss_pred             -----EEEeccCCceEEEEEecCcCCEEEEEeCCeEEEEE-ec
Confidence                 113333333488889999995 9999999999885 54


No 392
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=46.50  E-value=1.4e+02  Score=39.95  Aligned_cols=85  Identities=20%  Similarity=0.270  Sum_probs=52.9

Q ss_pred             eEEEEeecCCCc-eEeeeccc---c-c-ccCC---CCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCC
Q 000080          190 NLVSATWSIEGP-SATAASMS---Q-L-DLLG---PKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPG  260 (2389)
Q Consensus       190 ~ivsvaWSpdG~-fATag~di---k-f-~~~~---~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~  260 (2389)
                      .++.|.=|++|. .|-+|-+.   . . ++||   .-.++||+.+|..-+-..-.++.. -.-.+.-++|||.+.     
T Consensus       105 eV~~vl~s~~GS~VaL~G~~Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss-~~ltl~Qa~WHP~S~-----  178 (741)
T KOG4460|consen  105 EVYQVLLSPTGSHVALIGIKGLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSS-TSLTLKQAAWHPSSI-----  178 (741)
T ss_pred             EEEEEEecCCCceEEEecCCeeEEEEchhhcCccceecCCCceEEEEeecccceeeccC-CceeeeeccccCCcc-----
Confidence            556677789999 55555422   2 2 2354   346789999997644433334444 335788999999421     


Q ss_pred             CCccccCceEEeeecCCeEEEEEee
Q 000080          261 DTKRSQRHVLLTCCLDGTVRLWCEM  285 (2389)
Q Consensus       261 Dgk~~~~nILAScSdDgTVRLW~e~  285 (2389)
                          ...++++ =+-|++|||++..
T Consensus       179 ----~D~hL~i-L~sdnviRiy~lS  198 (741)
T KOG4460|consen  179 ----LDPHLVL-LTSDNVIRIYSLS  198 (741)
T ss_pred             ----CCceEEE-EecCcEEEEEecC
Confidence                1233333 3579999999976


No 393
>PF13449 Phytase-like:  Esterase-like activity of phytase
Probab=46.25  E-value=1.8e+02  Score=36.47  Aligned_cols=125  Identities=14%  Similarity=0.207  Sum_probs=73.9

Q ss_pred             EEEEcCCCCeEEEEeCC------CcEEEeecCCCceeeEecccCCCCCC------CCCCCCCEEEEEECCCCCEEEEEeC
Q 000080         2224 AFSSHPLRPFFLVGSSN------THIYLWEFGKDKATATYGVLPAANVP------PPYALASISALQFDHYGHRFASAAL 2291 (2389)
Q Consensus      2224 sVAFsPdG~~LASGS~D------gTIRLWDl~tGk~l~Tl~vl~gh~~p------~~GH~~~V~sVaFSPDG~~LASgS~ 2291 (2389)
                      +|++.++|.+++|.=.+      ..|+-++.. |+.+..+. +|...-+      ........-+++++|||++|.++-+
T Consensus        89 gi~~~~~g~~~is~E~~~~~~~~p~I~~~~~~-G~~~~~~~-vP~~~~~~~~~~~~~~~N~G~E~la~~~dG~~l~~~~E  166 (326)
T PF13449_consen   89 GIAVPPDGSFWISSEGGRTGGIPPRIRRFDLD-GRVIRRFP-VPAAFLPDANGTSGRRNNRGFEGLAVSPDGRTLFAAME  166 (326)
T ss_pred             HeEEecCCCEEEEeCCccCCCCCCEEEEECCC-CcccceEc-cccccccccCccccccCCCCeEEEEECCCCCEEEEEEC
Confidence            44778999999986666      778888865 88766663 2332100      0113457899999999996666543


Q ss_pred             -----CC--c-------EEEeeCC--CCCccCcccceeeee-----cCCCeeEEEEecCCCCEEEEee-cC-CCCCeEEE
Q 000080         2292 -----DG--T-------VCTWQLE--VGGRSNVRPMESCLC-----FSSHAMDVSYITSSGSVIAAAG-HS-SNGINVVV 2348 (2389)
Q Consensus      2292 -----Dg--T-------VkLWDl~--tggrs~~k~l~tl~g-----Hs~~V~sVAFSP~DGslLASAG-~s-S~D~TVrL 2348 (2389)
                           |+  .       +||+...  +.+...-+-.+.+..     ....+.++++.+ +|++|+-== +. .....+||
T Consensus       167 ~~l~~d~~~~~~~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~-d~~lLvLER~~~~~~~~~~ri  245 (326)
T PF13449_consen  167 SPLKQDGPRANPDNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALP-DGRLLVLERDFSPGTGNYKRI  245 (326)
T ss_pred             ccccCCCcccccccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEEC-CCcEEEEEccCCCCccceEEE
Confidence                 22  2       6666444  311000011223322     456788999999 888877310 00 13456777


Q ss_pred             eeC
Q 000080         2349 WDT 2351 (2389)
Q Consensus      2349 WD~ 2351 (2389)
                      ..+
T Consensus       246 ~~v  248 (326)
T PF13449_consen  246 YRV  248 (326)
T ss_pred             EEE
Confidence            765


No 394
>PRK11447 cellulose synthase subunit BcsC; Provisional
Probab=45.23  E-value=7.2e+02  Score=36.68  Aligned_cols=63  Identities=17%  Similarity=0.185  Sum_probs=44.4

Q ss_pred             HHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCCCcccccccccCCCCCCCccccccccccccccccccccHH
Q 000080         1463 AALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIGHSHILPEILKPSAATGSSNWLLRDVALHLESCAKLDLSL 1542 (2389)
Q Consensus      1463 ~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~ 1542 (2389)
                      .++..|..+.++|-.-.|+++++.                          .|.     +.++--..+..++...+.+.|+
T Consensus       575 ~~l~~a~~l~~~G~~~eA~~~l~~--------------------------~p~-----~~~~~~~La~~~~~~g~~~~A~  623 (1157)
T PRK11447        575 QVLETANRLRDSGKEAEAEALLRQ--------------------------QPP-----STRIDLTLADWAQQRGDYAAAR  623 (1157)
T ss_pred             HHHHHHHHHHHCCCHHHHHHHHHh--------------------------CCC-----CchHHHHHHHHHHHcCCHHHHH
Confidence            345667778999999999988872                          011     0112233455677888999999


Q ss_pred             HHHHHHhhcCCCCC
Q 000080         1543 QYFSKLIRDHPSWP 1556 (2389)
Q Consensus      1543 ~~~s~~~~~~~~~~ 1556 (2389)
                      .+|.++++..|.-+
T Consensus       624 ~~y~~al~~~P~~~  637 (1157)
T PRK11447        624 AAYQRVLTREPGNA  637 (1157)
T ss_pred             HHHHHHHHhCCCCH
Confidence            99999999987543


No 395
>PF14655 RAB3GAP2_N:  Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=43.45  E-value=83  Score=41.20  Aligned_cols=77  Identities=13%  Similarity=0.130  Sum_probs=50.3

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC--------------CCEE
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY--------------GHRF 2286 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD--------------G~~L 2286 (2389)
                      .+.+|+.+|++++.|..-.=|.|.|+|+.++..++.+++..+.      +.++|....-...              ..+|
T Consensus       309 ~~~~i~~sP~~~laA~tDslGRV~LiD~~~~~vvrmWKGYRdA------qc~wi~~~~~~~~~~~~~~~~~~~~~~~l~L  382 (415)
T PF14655_consen  309 EGESICLSPSGRLAAVTDSLGRVLLIDVARGIVVRMWKGYRDA------QCGWIEVPEEGDRDRSNSNSPKSSSRFALFL  382 (415)
T ss_pred             eEEEEEECCCCCEEEEEcCCCcEEEEECCCChhhhhhccCccc------eEEEEEeecccccccccccccCCCCcceEEE
Confidence            3578899999999888777799999999999988777643332      1223322222111              1122


Q ss_pred             EE-EeCCCcEEEeeCCCC
Q 000080         2287 AS-AALDGTVCTWQLEVG 2303 (2389)
Q Consensus      2287 AS-gS~DgTVkLWDl~tg 2303 (2389)
                      +- +-.=|.|-+|++++|
T Consensus       383 vIyaprRg~lEvW~~~~g  400 (415)
T PF14655_consen  383 VIYAPRRGILEVWSMRQG  400 (415)
T ss_pred             EEEeccCCeEEEEecCCC
Confidence            22 445688889988876


No 396
>PLN00033 photosystem II stability/assembly factor; Provisional
Probab=43.39  E-value=4.5e+02  Score=34.51  Aligned_cols=133  Identities=13%  Similarity=0.039  Sum_probs=74.4

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCC-ceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKD-KATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tG-k~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      ..+...+||.+++.|....-.+-||-+.. ......   +        ....++++.|.+||..++.+ .+|.+ +|...
T Consensus       242 ~~v~~~~dG~~~~vg~~G~~~~s~d~G~~~W~~~~~---~--------~~~~l~~v~~~~dg~l~l~g-~~G~l-~~S~d  308 (398)
T PLN00033        242 STVNRSPDGDYVAVSSRGNFYLTWEPGQPYWQPHNR---A--------SARRIQNMGWRADGGLWLLT-RGGGL-YVSKG  308 (398)
T ss_pred             eeEEEcCCCCEEEEECCccEEEecCCCCcceEEecC---C--------CccceeeeeEcCCCCEEEEe-CCceE-EEecC
Confidence            55678899999888766665667875422 122221   1        12568999999999888766 44553 33333


Q ss_pred             CCCccC-cccceeeee--cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEE---EeecCcEEEEeec
Q 000080         2302 VGGRSN-VRPMESCLC--FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASI---TCHEGLYDLFLPL 2375 (2389)
Q Consensus      2302 tggrs~-~k~l~tl~g--Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL---~GH~~~V~svA~~ 2375 (2389)
                      .+ +.- ...+....-  -...+.++.|.+ +++.+|++    .++.|....-   .++.=+..   ..=....+.+.+.
T Consensus       309 ~G-~~~~~~~f~~~~~~~~~~~l~~v~~~~-d~~~~a~G----~~G~v~~s~D---~G~tW~~~~~~~~~~~~ly~v~f~  379 (398)
T PLN00033        309 TG-LTEEDFDFEEADIKSRGFGILDVGYRS-KKEAWAAG----GSGILLRSTD---GGKSWKRDKGADNIAANLYSVKFF  379 (398)
T ss_pred             CC-CcccccceeecccCCCCcceEEEEEcC-CCcEEEEE----CCCcEEEeCC---CCcceeEccccCCCCcceeEEEEc
Confidence            22 100 001121111  113478899998 88988874    6677766652   23332222   2223445667655


Q ss_pred             cc
Q 000080         2376 KL 2377 (2389)
Q Consensus      2376 ~~ 2377 (2389)
                      ..
T Consensus       380 ~~  381 (398)
T PLN00033        380 DD  381 (398)
T ss_pred             CC
Confidence            43


No 397
>PF12110 Nup96:  Nuclear protein 96;  InterPro: IPR021967  Nup96 (often known by the name of its yeast homologue Nup145C) is part of the Nup84 heptameric complex in the nuclear pore complex. Nup96 complexes with Sec13 in the middle of the heptamer. The function of the heptamer is to coat the curvature of the nuclear pore complex between the inner and outer nuclear membranes. Nup96 is predicted to be an alpha helical solenoid. The interaction between Nup96 and Sec13 is the point of curvature in the heptameric complex [], [].; PDB: 3BG1_C 3BG0_F 3IKO_B.
Probab=43.35  E-value=32  Score=42.48  Aligned_cols=48  Identities=25%  Similarity=0.397  Sum_probs=32.6

Q ss_pred             hHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhh
Q 000080         1325 LELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTK 1376 (2389)
Q Consensus      1325 y~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~ 1376 (2389)
                      |+..+--.|.++++.+|++++++. +|+.||.+|+-+ .  ++|..|.++++
T Consensus         2 ~le~if~~L~~~~i~~A~~~A~~~-~n~~LA~Llsq~-~--~~~~~r~~~~~   49 (290)
T PF12110_consen    2 PLEKIFLLLSGHDIEEACELAIDS-GNPHLATLLSQI-G--GDPAVRSLAKQ   49 (290)
T ss_dssp             HHHHHHHHHHTT-HHHHHHHHHHT-T-HHHHHHHHHT-S----HHHHHHHHH
T ss_pred             HHHHHHHHHHCCCHHHHHHHHHHC-CCchHHHHHHHh-c--CCHHHHHHHHH
Confidence            344555567788999999999987 999999999999 2  23445444443


No 398
>PF14761 HPS3_N:  Hermansky-Pudlak syndrome 3
Probab=43.16  E-value=5.1e+02  Score=31.67  Aligned_cols=126  Identities=15%  Similarity=0.166  Sum_probs=74.5

Q ss_pred             CcE-EEecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc--------eEEeeccCCcEEEE
Q 000080          110 GQL-AAASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME--------TVLWKKKNTLWEIA  180 (2389)
Q Consensus       110 GeI-aASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD--------V~IW~~~~s~Wecv  180 (2389)
                      +.| +|..+++|.+|.-..    ..  =....++.--++|+.++.+..|++|+|--.+        ++++-.    |++.
T Consensus        29 d~Lfva~~g~~Vev~~l~~----~~--~~~~~~F~Tv~~V~~l~y~~~GDYlvTlE~k~~~~~~~fvR~Y~N----Wr~~   98 (215)
T PF14761_consen   29 DALFVAASGCKVEVYDLEQ----EE--CPLLCTFSTVGRVLQLVYSEAGDYLVTLEEKNKRSPVDFVRAYFN----WRSQ   98 (215)
T ss_pred             ceEEEEcCCCEEEEEEccc----CC--CceeEEEcchhheeEEEeccccceEEEEEeecCCccceEEEEEEE----hhhh
Confidence            455 357789999998541    01  1223445445899999999999999986553        333331    4332


Q ss_pred             EEeeccccceEEEEeecCCCceEeeecccccccCCCCCCCceeEEEeeCCCccceeecccCCCCeeEEEeccCCCCCCCC
Q 000080          181 WKFKENYPQNLVSATWSIEGPSATAASMSQLDLLGPKEAGKCVFICCSDGKSEYIKLELCHPQPVSMVQWRPSTRRHSPG  260 (2389)
Q Consensus       181 wt~~~~~~~~ivsvaWSpdG~fATag~dikf~~~~~~~~~kpV~V~~~dg~~~~~~ve~aH~qdVn~V~W~Ps~~~~~~~  260 (2389)
                      .    ....++ ++      .+|  |...+    +..   .      ...+.+.+.+|..=+.++.+|+=.|        
T Consensus        99 ~----~~~~~v-~v------Ria--G~~v~----~~~---~------~~~~~qleiiElPl~~~p~ciaCC~--------  144 (215)
T PF14761_consen   99 K----EENSPV-RV------RIA--GHRVT----PSF---N------ESSKDQLEIIELPLSEPPLCIACCP--------  144 (215)
T ss_pred             c----ccCCcE-EE------EEc--ccccc----cCC---C------CccccceEEEEecCCCCCCEEEecC--------
Confidence            1    011111 11      011  11111    000   0      0113346677888888999999999        


Q ss_pred             CCccccCceEEeeecCCeEEEEEee
Q 000080          261 DTKRSQRHVLLTCCLDGTVRLWCEM  285 (2389)
Q Consensus       261 Dgk~~~~nILAScSdDgTVRLW~e~  285 (2389)
                          ...|+|+.|  ++++-||...
T Consensus       145 ----~tG~LlVg~--~~~l~lf~l~  163 (215)
T PF14761_consen  145 ----VTGNLLVGC--GNKLVLFTLK  163 (215)
T ss_pred             ----CCCCEEEEc--CCEEEEEEEE
Confidence                467888877  7899999976


No 399
>KOG4460 consensus Nuclear pore complex, Nup88/rNup84 component [Nuclear structure; Intracellular trafficking, secretion, and vesicular transport]
Probab=42.40  E-value=61  Score=43.02  Aligned_cols=82  Identities=23%  Similarity=0.329  Sum_probs=51.8

Q ss_pred             CcceeecCCCCCCeEEEEecCCcEEEEeCCC---Cccccc-------ccccccceeeeeccCCCCCeeEEEEcCCCCCCC
Q 000080           41 TSTIDWLPDFAGYSWVAYGASSLLVISHFPS---PLSQEE-------ALIGPIFRQVFALSDNSLPVTSISWSPETPSIG  110 (2389)
Q Consensus        41 ~~ai~wlpD~~G~~~vAYasg~~vVI~~l~S---P~~~~e-------~~~~p~~~Qviegh~d~~dVk~VaWSPd~~~~G  110 (2389)
                      +.++.-+|.  | +-||-+..++++|--||-   |.+.++       |..=|+=-|++.-+.+ ..++-++|||++-+-.
T Consensus       106 V~~vl~s~~--G-S~VaL~G~~Gi~vMeLp~rwG~~s~~eDgk~~v~CRt~~i~~~~ftss~~-ltl~Qa~WHP~S~~D~  181 (741)
T KOG4460|consen  106 VYQVLLSPT--G-SHVALIGIKGLMVMELPKRWGKNSEFEDGKSTVNCRTTPVAERFFTSSTS-LTLKQAAWHPSSILDP  181 (741)
T ss_pred             EEEEEecCC--C-ceEEEecCCeeEEEEchhhcCccceecCCCceEEEEeecccceeeccCCc-eeeeeccccCCccCCc
Confidence            344444454  6 689999999999988763   443333       1112444455555433 5799999999721112


Q ss_pred             cEE-EecCCeEEEEeeC
Q 000080          111 QLA-AASENCIFVFAHD  126 (2389)
Q Consensus       111 eIa-ASyDntIRVw~~d  126 (2389)
                      -++ -++||+||||...
T Consensus       182 hL~iL~sdnviRiy~lS  198 (741)
T KOG4460|consen  182 HLVLLTSDNVIRIYSLS  198 (741)
T ss_pred             eEEEEecCcEEEEEecC
Confidence            233 5889999999875


No 400
>PF12931 Sec16_C:  Sec23-binding domain of Sec16; PDB: 3MZK_C.
Probab=42.24  E-value=43  Score=41.30  Aligned_cols=75  Identities=21%  Similarity=0.252  Sum_probs=44.0

Q ss_pred             HHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhccccccccCC------hhHHHHHHHHhCChhHHH
Q 000080         1332 FLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSIERGD------YWLTSLLEWELGNYSQSF 1405 (2389)
Q Consensus      1332 FLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gD------rwL~S~a~W~L~~~~~Av 1405 (2389)
                      +||.|+.++||+.|+++ ++...|++||+....   ...+++.++++--.- ..++      ..|+-+.-=.-|+-..+|
T Consensus         5 ~Ll~G~~~~Av~~al~~-~~wa~ALlLAs~~g~---e~~~~v~~~y~~~~~-~~~~~~~~~~~~L~~l~~v~~g~~~~~v   79 (284)
T PF12931_consen    5 LLLVGNREEAVELALDN-GLWAHALLLASSLGP---ELWKKVVQEYFRREF-SAGSPSSKITHLLRTLYQVFSGNSPEAV   79 (284)
T ss_dssp             HHHTT-HHHHHHHHHHT-T-HHHHHHHHHTS-H---HHHHHHHHHHHH---------THHHHHHHHHHHHHTTT-HHHHH
T ss_pred             HHhCCCHHHHHHHHHHC-CChHHHHHHHHhcCH---HHHHHHHHHHHHHhc-cCCCCcchhhHHHHHHHHHHcCCcHHHH
Confidence            68999999999999998 999999999998833   345555555443221 1122      233333333346666677


Q ss_pred             HHHhcC
Q 000080         1406 LTMLGF 1411 (2389)
Q Consensus      1406 ~~Ll~~ 1411 (2389)
                      +.|...
T Consensus        80 ~~l~~~   85 (284)
T PF12931_consen   80 DELVPN   85 (284)
T ss_dssp             HHHHH-
T ss_pred             HHhccc
Confidence            766654


No 401
>PF05935 Arylsulfotrans:  Arylsulfotransferase (ASST);  InterPro: IPR010262 This family consists of several bacterial arylsulphotransferase proteins. Arylsulphotransferase (ASST) transfers a sulphate group from phenolic sulphate esters to a phenolic acceptor substrate [].; PDB: 3ETT_B 3ELQ_A 3ETS_A.
Probab=41.40  E-value=2.6e+02  Score=37.22  Aligned_cols=124  Identities=17%  Similarity=0.231  Sum_probs=63.2

Q ss_pred             EEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEe--------------
Q 000080         2225 FSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAA-------------- 2290 (2389)
Q Consensus      2225 VAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS-------------- 2290 (2389)
                      +-+-++|.+++..+  ..++..|+ -|+.+..+. +++...  .-|    +.+.+-|+|+.|+.+.              
T Consensus       153 ~~~l~nG~ll~~~~--~~~~e~D~-~G~v~~~~~-l~~~~~--~~H----HD~~~l~nGn~L~l~~~~~~~~~~~~~~~~  222 (477)
T PF05935_consen  153 FKQLPNGNLLIGSG--NRLYEIDL-LGKVIWEYD-LPGGYY--DFH----HDIDELPNGNLLILASETKYVDEDKDVDTV  222 (477)
T ss_dssp             EEE-TTS-EEEEEB--TEEEEE-T-T--EEEEEE---TTEE---B-----S-EEE-TTS-EEEEEEETTEE-TS-EE---
T ss_pred             eeEcCCCCEEEecC--CceEEEcC-CCCEEEeee-cCCccc--ccc----cccEECCCCCEEEEEeecccccCCCCccEe
Confidence            56789999887655  88999998 688777765 333100  003    4566889999999888              


Q ss_pred             CC---------CcEEEeeCCCCCccCccccee----------eeecC-----CCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2291 LD---------GTVCTWQLEVGGRSNVRPMES----------CLCFS-----SHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2291 ~D---------gTVkLWDl~tggrs~~k~l~t----------l~gHs-----~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      .|         ..|..||+..    .+.+.+.          ..+-.     -+++++.|.+.++.+|+|+   =.-.+|
T Consensus       223 ~D~Ivevd~tG~vv~~wd~~d----~ld~~~~~~~~~~~~~~~~~~~~~~DW~H~Nsi~yd~~dd~iivSs---R~~s~V  295 (477)
T PF05935_consen  223 EDVIVEVDPTGEVVWEWDFFD----HLDPYRDTVLKPYPYGDISGSGGGRDWLHINSIDYDPSDDSIIVSS---RHQSAV  295 (477)
T ss_dssp             S-EEEEE-TTS-EEEEEEGGG----TS-TT--TTGGT--SSSSS-SSTTSBS--EEEEEEETTTTEEEEEE---TTT-EE
T ss_pred             cCEEEEECCCCCEEEEEehHH----hCCcccccccccccccccccCCCCCCccccCccEEeCCCCeEEEEc---CcceEE
Confidence            23         3344565543    1111111          00000     4789999999788899884   123366


Q ss_pred             EEeeCCCCCCCceEEEEeecC
Q 000080         2347 VVWDTLAPPTSSRASITCHEG 2367 (2389)
Q Consensus      2347 rLWD~l~~tg~~v~sL~GH~~ 2367 (2389)
                      -..|.  .+++.+..|-.|.+
T Consensus       296 ~~Id~--~t~~i~Wilg~~~~  314 (477)
T PF05935_consen  296 IKIDY--RTGKIKWILGPPGG  314 (477)
T ss_dssp             EEEE---TTS-EEEEES-STT
T ss_pred             EEEEC--CCCcEEEEeCCCCC
Confidence            66663  45555555555543


No 402
>PF07569 Hira:  TUP1-like enhancer of split;  InterPro: IPR011494 The Hira proteins are found in a range of eukaryotes and are implicated in the assembly of repressive chromatin. These proteins also contain IPR001680 from INTERPRO.; GO: 0006355 regulation of transcription, DNA-dependent, 0005634 nucleus
Probab=41.27  E-value=89  Score=37.36  Aligned_cols=69  Identities=16%  Similarity=0.279  Sum_probs=49.8

Q ss_pred             EEECCCCCEEEEEeCCCcEEEeeCCCCCccCccc--ceeee--------ecCCCeeEEEEecCCCCEEEEeecCCCCCeE
Q 000080         2277 LQFDHYGHRFASAALDGTVCTWQLEVGGRSNVRP--MESCL--------CFSSHAMDVSYITSSGSVIAAAGHSSNGINV 2346 (2389)
Q Consensus      2277 VaFSPDG~~LASgS~DgTVkLWDl~tggrs~~k~--l~tl~--------gHs~~V~sVAFSP~DGslLASAG~sS~D~TV 2346 (2389)
                      +.+..+|++|..-..+|.+++||+.++. ...++  +..+.        .....|.++.+.. +|..|++-    .++..
T Consensus        16 ~~l~~~~~~Ll~iT~~G~l~vWnl~~~k-~~~~~~Si~pll~~~~~~~~~~~~~i~~~~lt~-~G~PiV~l----sng~~   89 (219)
T PF07569_consen   16 SFLECNGSYLLAITSSGLLYVWNLKKGK-AVLPPVSIAPLLNSSPVSDKSSSPNITSCSLTS-NGVPIVTL----SNGDS   89 (219)
T ss_pred             EEEEeCCCEEEEEeCCCeEEEEECCCCe-eccCCccHHHHhcccccccCCCCCcEEEEEEcC-CCCEEEEE----eCCCE
Confidence            4467889999999999999999999863 11111  11111        3557788888886 99999874    35678


Q ss_pred             EEeeC
Q 000080         2347 VVWDT 2351 (2389)
Q Consensus      2347 rLWD~ 2351 (2389)
                      -.||.
T Consensus        90 y~y~~   94 (219)
T PF07569_consen   90 YSYSP   94 (219)
T ss_pred             EEecc
Confidence            88986


No 403
>KOG4441 consensus Proteins containing BTB/POZ and Kelch domains, involved in regulatory/signal transduction processes [Signal transduction mechanisms; General function prediction only]
Probab=41.24  E-value=2.4e+02  Score=38.51  Aligned_cols=136  Identities=11%  Similarity=0.121  Sum_probs=72.0

Q ss_pred             eeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCC------CcEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080         2197 SALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSN------THIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus      2197 sg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~D------gTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
                      +..-||...+.|....+......  -.++++. +|.++++||.|      .++..+|..+++=.. .     ..|..+.+
T Consensus       302 ~ve~yd~~~~~w~~~a~m~~~r~--~~~~~~~-~~~lYv~GG~~~~~~~l~~ve~YD~~~~~W~~-~-----a~M~~~R~  372 (571)
T KOG4441|consen  302 SVECYDPKTNEWSSLAPMPSPRC--RVGVAVL-NGKLYVVGGYDSGSDRLSSVERYDPRTNQWTP-V-----APMNTKRS  372 (571)
T ss_pred             eeEEecCCcCcEeecCCCCcccc--cccEEEE-CCEEEEEccccCCCcccceEEEecCCCCceec-c-----CCccCccc
Confidence            34456666666655422222111  1233444 46899999999      467788887665211 1     11222222


Q ss_pred             CCCEEEEEECCCCCEEEEEeCCCc-----EEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCC--
Q 000080         2271 LASISALQFDHYGHRFASAALDGT-----VCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNG-- 2343 (2389)
Q Consensus      2271 ~~~V~sVaFSPDG~~LASgS~DgT-----VkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D-- 2343 (2389)
                      ...|.    .-+|...|.|+.||.     |-.||.++..      -............++--.-+|.+.|.||.+...  
T Consensus       373 ~~~v~----~l~g~iYavGG~dg~~~l~svE~YDp~~~~------W~~va~m~~~r~~~gv~~~~g~iYi~GG~~~~~~~  442 (571)
T KOG4441|consen  373 DFGVA----VLDGKLYAVGGFDGEKSLNSVECYDPVTNK------WTPVAPMLTRRSGHGVAVLGGKLYIIGGGDGSSNC  442 (571)
T ss_pred             cceeE----EECCEEEEEeccccccccccEEEecCCCCc------ccccCCCCcceeeeEEEEECCEEEEEcCcCCCccc
Confidence            22332    238999999999965     5566666531      011111111222222222268999998855444  


Q ss_pred             -CeEEEeeC
Q 000080         2344 -INVVVWDT 2351 (2389)
Q Consensus      2344 -~TVrLWD~ 2351 (2389)
                       ++|..+|.
T Consensus       443 l~sve~YDP  451 (571)
T KOG4441|consen  443 LNSVECYDP  451 (571)
T ss_pred             cceEEEEcC
Confidence             56777775


No 404
>PF03178 CPSF_A:  CPSF A subunit region;  InterPro: IPR004871 This family includes a region that lies towards the C terminus of the cleavage and polyadenylation specificity factor (CPSF) A (160 kDa) subunit. CPSF is involved in mRNA polyadenylation and binds the AAUAAA conserved sequence in pre-mRNA. CPSF has also been found to be necessary for splicing of single-intron pre-mRNAs []. The function of the aligned region is unknown but may be involved in RNA/DNA binding.; GO: 0003676 nucleic acid binding, 0005634 nucleus; PDB: 2B5M_A 4A0K_C 4A0B_C 3I7L_A 3I8E_A 4A09_A 4A0A_A 3EI4_C 2B5L_A 3I7O_A ....
Probab=39.61  E-value=8.3e+02  Score=30.29  Aligned_cols=98  Identities=17%  Similarity=0.236  Sum_probs=63.0

Q ss_pred             CeeEEEEcCCCCCCCcEEEecCCeEEEEeeCCCCCCCCccceeeEEecccceEEEEeecCCCCeEEEEecc--eEEe--e
Q 000080           96 PVTSISWSPETPSIGQLAAASENCIFVFAHDSASSKGSFCWSQNAILVQGTKVEAIEWTGSGDGIVAGGME--TVLW--K  171 (2389)
Q Consensus        96 dVk~VaWSPd~~~~GeIaASyDntIRVw~~d~~~~kgd~~W~~~~tL~hssTV~sIAWSpdG~rLaSggdD--V~IW--~  171 (2389)
                      +|.+++=--     |.|+++.++.|.+|+-+.    .+ .+...+.......|.+|..-  +++|+.|.-.  +.+.  +
T Consensus        90 ~V~ai~~~~-----~~lv~~~g~~l~v~~l~~----~~-~l~~~~~~~~~~~i~sl~~~--~~~I~vgD~~~sv~~~~~~  157 (321)
T PF03178_consen   90 PVTAICSFN-----GRLVVAVGNKLYVYDLDN----SK-TLLKKAFYDSPFYITSLSVF--KNYILVGDAMKSVSLLRYD  157 (321)
T ss_dssp             -EEEEEEET-----TEEEEEETTEEEEEEEET----TS-SEEEEEEE-BSSSEEEEEEE--TTEEEEEESSSSEEEEEEE
T ss_pred             cceEhhhhC-----CEEEEeecCEEEEEEccC----cc-cchhhheecceEEEEEEecc--ccEEEEEEcccCEEEEEEE
Confidence            677776654     679999999999999872    11 47777777666688888777  4577755432  5554  5


Q ss_pred             ccCCcEEEEEEeeccccceEEEEeecCCCc-eEeeec
Q 000080          172 KKNTLWEIAWKFKENYPQNLVSATWSIEGP-SATAAS  207 (2389)
Q Consensus       172 ~~~s~Wecvwt~~~~~~~~ivsvaWSpdG~-fATag~  207 (2389)
                      .....-+.+.+  ...+..+.++..-+|+. ++.+-.
T Consensus       158 ~~~~~l~~va~--d~~~~~v~~~~~l~d~~~~i~~D~  192 (321)
T PF03178_consen  158 EENNKLILVAR--DYQPRWVTAAEFLVDEDTIIVGDK  192 (321)
T ss_dssp             TTTE-EEEEEE--ESS-BEEEEEEEE-SSSEEEEEET
T ss_pred             ccCCEEEEEEe--cCCCccEEEEEEecCCcEEEEEcC
Confidence            54445666654  45577788887777775 555544


No 405
>KOG4649 consensus PQQ (pyrrolo-quinoline quinone) repeat protein [Secondary metabolites biosynthesis, transport and catabolism]
Probab=37.41  E-value=2.2e+02  Score=35.50  Aligned_cols=71  Identities=15%  Similarity=0.252  Sum_probs=54.4

Q ss_pred             CCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCE-EEEEECCCCCEEEEEeCCCcEEEeeCCCCCccCc
Q 000080         2230 LRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASI-SALQFDHYGHRFASAALDGTVCTWQLEVGGRSNV 2308 (2389)
Q Consensus      2230 dG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V-~sVaFSPDG~~LASgS~DgTVkLWDl~tggrs~~ 2308 (2389)
                      =|.+++-|-..|-+++=++.+|.+...|.-+           ..| .+-+..+||..+-.|+.|++...-|.++.+    
T Consensus        62 vgdfVV~GCy~g~lYfl~~~tGs~~w~f~~~-----------~~vk~~a~~d~~~glIycgshd~~~yalD~~~~~----  126 (354)
T KOG4649|consen   62 VGDFVVLGCYSGGLYFLCVKTGSQIWNFVIL-----------ETVKVRAQCDFDGGLIYCGSHDGNFYALDPKTYG----  126 (354)
T ss_pred             ECCEEEEEEccCcEEEEEecchhheeeeeeh-----------hhhccceEEcCCCceEEEecCCCcEEEecccccc----
Confidence            3778999999999999999999877666421           112 234578999999999999999999998753    


Q ss_pred             ccceeeee
Q 000080         2309 RPMESCLC 2316 (2389)
Q Consensus      2309 k~l~tl~g 2316 (2389)
                       ++...++
T Consensus       127 -cVykskc  133 (354)
T KOG4649|consen  127 -CVYKSKC  133 (354)
T ss_pred             -eEEeccc
Confidence             4555444


No 406
>TIGR03118 PEPCTERM_chp_1 conserved hypothetical protein TIGR03118. This model describes and uncharacterized conserved hypothetical protein. Members are found with the C-terminal putative exosortase interaction domain, PEP-CTERM, in Nitrosospira multiformis, Rhodoferax ferrireducens, Solibacter usitatus Ellin6076, and Acidobacteria bacterium Ellin345. It is found without the PEP-CTERM domain in several other species, including Burkholderia ambifaria, Gloeobacter violaceus PCC 7421, and three copies in the Acanthamoeba polyphaga mimivirus.
Probab=35.92  E-value=4.1e+02  Score=34.12  Aligned_cols=124  Identities=19%  Similarity=0.248  Sum_probs=73.5

Q ss_pred             cCceeEEEEEEcCCCCeEEEEeCCCcEEEeecC------CCce-eeEecccCCCCCCCCC--CCCCEEEEEECCCCC---
Q 000080         2217 VENISTRAFSSHPLRPFFLVGSSNTHIYLWEFG------KDKA-TATYGVLPAANVPPPY--ALASISALQFDHYGH--- 2284 (2389)
Q Consensus      2217 v~ni~VrsVAFsPdG~~LASGS~DgTIRLWDl~------tGk~-l~Tl~vl~gh~~p~~G--H~~~V~sVaFSPDG~--- 2284 (2389)
                      +.|-  |.|+|+|.+++-++...-++..|+|..      .++. +.+.   |+.    ++  ..+..+.+.|+.-..   
T Consensus        22 L~N~--WGia~~p~~~~WVadngT~~~TlYdg~~~~~~g~~~~L~vti---P~~----~~~~~~~~PTGiVfN~~~~F~v   92 (336)
T TIGR03118        22 LRNA--WGLSYRPGGPFWVANTGTGTATLYVGNPDTQPLVQDPLVVVI---PAP----PPLAAEGTPTGQVFNGSDTFVV   92 (336)
T ss_pred             cccc--ceeEecCCCCEEEecCCcceEEeecCCcccccCCccceEEEe---cCC----CCCCCCCCccEEEEeCCCceEE
Confidence            4455  889999999999988888999999985      2222 2222   221    11  124578888884433   


Q ss_pred             ---------EEEEEeCCCcEEEeeCCCCCccCcccceeeee-cCCCee-EEEEecC-CCCEEEEeecCCCCCeEEEeeC
Q 000080         2285 ---------RFASAALDGTVCTWQLEVGGRSNVRPMESCLC-FSSHAM-DVSYITS-SGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2285 ---------~LASgS~DgTVkLWDl~tggrs~~k~l~tl~g-Hs~~V~-sVAFSP~-DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                               .|.-+++||||.=|.-..+.......+..... -.+.|+ .+|+-+. .+.+|-.+-+  ..++|.+.|-
T Consensus        93 t~~g~~~~a~Fif~tEdGTisaW~p~v~~t~~~~~~~~~d~s~~gavYkGLAi~~~~~~~~LYaadF--~~g~IDVFd~  169 (336)
T TIGR03118        93 SGEGITGPSRFLFVTEDGTLSGWAPALGTTRMTRAEIVVDASQQGNVYKGLAVGPTGGGDYLYAANF--RQGRIDVFKG  169 (336)
T ss_pred             cCCCcccceeEEEEeCCceEEeecCcCCcccccccEEEEccCCCcceeeeeEEeecCCCceEEEecc--CCCceEEecC
Confidence                     36788999999999865531000011111211 124555 3555431 2455554444  6788999995


No 407
>PF14583 Pectate_lyase22:  Oligogalacturonate lyase; PDB: 3C5M_C 3PE7_A.
Probab=34.13  E-value=4.2e+02  Score=34.85  Aligned_cols=130  Identities=13%  Similarity=0.084  Sum_probs=61.3

Q ss_pred             eccccccc-cccccc-cCC------CCcCceeEEEEEEcCCCCeEEE-----EeCCCcEEEeecCCCceeeEecccCCCC
Q 000080         2198 ALGWETQD-DFEDYV-DPP------ATVENISTRAFSSHPLRPFFLV-----GSSNTHIYLWEFGKDKATATYGVLPAAN 2264 (2389)
Q Consensus      2198 g~~~d~~~-~~~~~~-d~~------atv~ni~VrsVAFsPdG~~LAS-----GS~DgTIRLWDl~tGk~l~Tl~vl~gh~ 2264 (2389)
                      | .|+..+ |+|-.. |..      +..++..+--=-|.|||..|.-     |+.+..|.=.|..+++.....+      
T Consensus       209 G-pw~~Vd~RiW~i~~dg~~~~~v~~~~~~e~~gHEfw~~DG~~i~y~~~~~~~~~~~i~~~d~~t~~~~~~~~------  281 (386)
T PF14583_consen  209 G-PWDLVDQRIWTINTDGSNVKKVHRRMEGESVGHEFWVPDGSTIWYDSYTPGGQDFWIAGYDPDTGERRRLME------  281 (386)
T ss_dssp             S--TTTSS-SEEEEETTS---EESS---TTEEEEEEEE-TTSS-EEEEEEETTT--EEEEEE-TTT--EEEEEE------
T ss_pred             C-CcceeceEEEEEEcCCCcceeeecCCCCcccccccccCCCCEEEEEeecCCCCceEEEeeCCCCCCceEEEe------
Confidence            5 788876 888663 111      1111223333468899985443     3456678888888887544332      


Q ss_pred             CCCCCCCCCEEEEEECCCCCEEEEEeCCC----------------cEEEeeCCCCCccCcccceeeeecC---------C
Q 000080         2265 VPPPYALASISALQFDHYGHRFASAALDG----------------TVCTWQLEVGGRSNVRPMESCLCFS---------S 2319 (2389)
Q Consensus      2265 ~p~~GH~~~V~sVaFSPDG~~LASgS~Dg----------------TVkLWDl~tggrs~~k~l~tl~gHs---------~ 2319 (2389)
                      |      .+-.-.--|+||+++|.=+.|.                -|.|++++.+.      ...+.-|.         .
T Consensus       282 ~------p~~~H~~ss~Dg~L~vGDG~d~p~~v~~~~~~~~~~~p~i~~~~~~~~~------~~~l~~h~~sw~v~~~~~  349 (386)
T PF14583_consen  282 M------PWCSHFMSSPDGKLFVGDGGDAPVDVADAGGYKIENDPWIYLFDVEAGR------FRKLARHDTSWKVLDGDR  349 (386)
T ss_dssp             E-------SEEEEEE-TTSSEEEEEE-------------------EEEEEETTTTE------EEEEEE-------BTTBS
T ss_pred             C------CceeeeEEcCCCCEEEecCCCCCccccccccceecCCcEEEEeccccCc------eeeeeeccCcceeecCCC
Confidence            1      2234455679999997755542                45678888652      11111121         1


Q ss_pred             C--eeEEEEecCCCCEEEEeecCCCCCeEEEe
Q 000080         2320 H--AMDVSYITSSGSVIAAAGHSSNGINVVVW 2349 (2389)
Q Consensus      2320 ~--V~sVAFSP~DGslLASAG~sS~D~TVrLW 2349 (2389)
                      .  -.-+.|+| ||+.|.-.+  ...|..-|+
T Consensus       350 q~~hPhp~FSP-Dgk~VlF~S--d~~G~~~vY  378 (386)
T PF14583_consen  350 QVTHPHPSFSP-DGKWVLFRS--DMEGPPAVY  378 (386)
T ss_dssp             STT----EE-T-TSSEEEEEE---TTSS-EEE
T ss_pred             ccCCCCCccCC-CCCEEEEEC--CCCCCccEE
Confidence            1  12478999 889888653  344444443


No 408
>PF13449 Phytase-like:  Esterase-like activity of phytase
Probab=33.01  E-value=6.2e+02  Score=31.94  Aligned_cols=156  Identities=12%  Similarity=0.051  Sum_probs=84.7

Q ss_pred             EEEEEcCCCCeEEEEeCCCc------EEEeecCC--C--ceeeEec--ccCCCC-CCCCCCCCCEEEEEECCCCCEEEEE
Q 000080         2223 RAFSSHPLRPFFLVGSSNTH------IYLWEFGK--D--KATATYG--VLPAAN-VPPPYALASISALQFDHYGHRFASA 2289 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgT------IRLWDl~t--G--k~l~Tl~--vl~gh~-~p~~GH~~~V~sVaFSPDG~~LASg 2289 (2389)
                      ..|++.|++..+++-|+++.      +...++..  +  ..+....  .+.+.+ .|..+-....-+|++.++|.++.|-
T Consensus        23 Sgl~~~~~~~~~~avSD~g~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~L~~~~G~~~~~~~~D~Egi~~~~~g~~~is~  102 (326)
T PF13449_consen   23 SGLDYDPDDGRFYAVSDRGPNKGPPRFYTFRIDYDQGGIGGVTILDMIPLRDPDGQPFPKNGLDPEGIAVPPDGSFWISS  102 (326)
T ss_pred             eeEEEeCCCCEEEEEECCCCCCCCCcEEEEEeeccCCCccceEeccceeccCCCCCcCCcCCCChhHeEEecCCCEEEEe
Confidence            67788866666666788888      66666543  1  1111110  011100 0100011245689998999988888


Q ss_pred             eCC------CcEEEeeCCCCCccCcccc-----e-------eeeecCCCeeEEEEecCCCCEEEEeecCC--CCC-----
Q 000080         2290 ALD------GTVCTWQLEVGGRSNVRPM-----E-------SCLCFSSHAMDVSYITSSGSVIAAAGHSS--NGI----- 2344 (2389)
Q Consensus      2290 S~D------gTVkLWDl~tggrs~~k~l-----~-------tl~gHs~~V~sVAFSP~DGslLASAG~sS--~D~----- 2344 (2389)
                      -.+      -.|.-.+.. | + ..+.+     .       .-...+....++|++| ||+.|.++--+.  .|+     
T Consensus       103 E~~~~~~~~p~I~~~~~~-G-~-~~~~~~vP~~~~~~~~~~~~~~~N~G~E~la~~~-dG~~l~~~~E~~l~~d~~~~~~  178 (326)
T PF13449_consen  103 EGGRTGGIPPRIRRFDLD-G-R-VIRRFPVPAAFLPDANGTSGRRNNRGFEGLAVSP-DGRTLFAAMESPLKQDGPRANP  178 (326)
T ss_pred             CCccCCCCCCEEEEECCC-C-c-ccceEccccccccccCccccccCCCCeEEEEECC-CCCEEEEEECccccCCCccccc
Confidence            888      777777765 3 2 11111     0       1122456677999999 889444331111  121     


Q ss_pred             ----eEEEeeCCCCC-CCce----EEEEe-----ecCcEEEEeecccchhhh
Q 000080         2345 ----NVVVWDTLAPP-TSSR----ASITC-----HEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2345 ----TVrLWD~l~~t-g~~v----~sL~G-----H~~~V~svA~~~~~~~~~ 2382 (2389)
                          .+||+.....+ ++..    ..+..     ...++..++..+++++.+
T Consensus       179 ~~~~~~ri~~~d~~~~~~~~~~~~y~ld~~~~~~~~~~isd~~al~d~~lLv  230 (326)
T PF13449_consen  179 DNGSPLRILRYDPKTPGEPVAEYAYPLDPPPTAPGDNGISDIAALPDGRLLV  230 (326)
T ss_pred             ccCceEEEEEecCCCCCccceEEEEeCCccccccCCCCceeEEEECCCcEEE
Confidence                27787764333 2222    33332     456788888888887543


No 409
>PF08728 CRT10:  CRT10;  InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance []. 
Probab=32.89  E-value=2.4e+02  Score=39.43  Aligned_cols=114  Identities=12%  Similarity=0.075  Sum_probs=71.0

Q ss_pred             CCCCeEEEEeCCCcEEEeecC-------CC----ce-eeEecccCCCCCCCCCCCCCEEEEEEC--CCCCEEEEEeCCCc
Q 000080         2229 PLRPFFLVGSSNTHIYLWEFG-------KD----KA-TATYGVLPAANVPPPYALASISALQFD--HYGHRFASAALDGT 2294 (2389)
Q Consensus      2229 PdG~~LASGS~DgTIRLWDl~-------tG----k~-l~Tl~vl~gh~~p~~GH~~~V~sVaFS--PDG~~LASgS~DgT 2294 (2389)
                      -+...|+.+.+||.|-+|.+.       ..    +. .....+.|.-   .......++++++.  ...+.||.++.-..
T Consensus       112 g~~EVLl~c~DdG~V~~Yyt~~I~~~i~~~~~~~~~~~~r~~i~P~f---~~~v~~SaWGLdIh~~~~~rlIAVSsNs~~  188 (717)
T PF08728_consen  112 GGEEVLLLCTDDGDVLAYYTETIIEAIERFSEDNDSGFSRLKIKPFF---HLRVGASAWGLDIHDYKKSRLIAVSSNSQE  188 (717)
T ss_pred             CCeeEEEEEecCCeEEEEEHHHHHHHHHhhccccccccccccCCCCe---EeecCCceeEEEEEecCcceEEEEecCCce
Confidence            345589999999999999652       00    00 0000000000   00112579999998  77899999999999


Q ss_pred             EEEeeCCCC-CccCcccceeeeecCCCeeEEEEecCC----CC-EEEEeecCCCCCeEEEeeC
Q 000080         2295 VCTWQLEVG-GRSNVRPMESCLCFSSHAMDVSYITSS----GS-VIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2295 VkLWDl~tg-grs~~k~l~tl~gHs~~V~sVAFSP~D----Gs-lLASAG~sS~D~TVrLWD~ 2351 (2389)
                      |.|+-.... .+   .....-..|..-|.+|+|.+++    |. .|+++   +-.|+|.+|++
T Consensus       189 VTVFaf~l~~~r---~~~~~s~~~~hNIP~VSFl~~~~d~~G~v~v~a~---dI~G~v~~~~I  245 (717)
T PF08728_consen  189 VTVFAFALVDER---FYHVPSHQHSHNIPNVSFLDDDLDPNGHVKVVAT---DISGEVWTFKI  245 (717)
T ss_pred             EEEEEEeccccc---cccccccccccCCCeeEeecCCCCCccceEEEEE---eccCcEEEEEE
Confidence            999966542 11   1111112367789999999853    32 56554   57888888887


No 410
>KOG4499 consensus Ca2+-binding protein Regucalcin/SMP30 [Inorganic ion transport and metabolism; Signal transduction mechanisms]
Probab=32.06  E-value=6.9e+02  Score=31.24  Aligned_cols=137  Identities=15%  Similarity=0.037  Sum_probs=81.2

Q ss_pred             EEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCE-------EEEEECCCCC-EEEEEeCCCc
Q 000080         2223 RAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASI-------SALQFDHYGH-RFASAALDGT 2294 (2389)
Q Consensus      2223 rsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V-------~sVaFSPDG~-~LASgS~DgT 2294 (2389)
                      ..-..+|+|++++--=.|-.- ..+.-.|. +...  +++|.      ..-|       ..++++.|.+ +...-|.+-+
T Consensus       112 NDgkvdP~Gryy~GtMad~~~-~le~~~g~-Ly~~--~~~h~------v~~i~~~v~IsNgl~Wd~d~K~fY~iDsln~~  181 (310)
T KOG4499|consen  112 NDGKVDPDGRYYGGTMADFGD-DLEPIGGE-LYSW--LAGHQ------VELIWNCVGISNGLAWDSDAKKFYYIDSLNYE  181 (310)
T ss_pred             ccCccCCCCceeeeeeccccc-cccccccE-EEEe--ccCCC------ceeeehhccCCccccccccCcEEEEEccCceE
Confidence            344689999996532233222 22222222 3333  23442      1222       3567777775 5567788999


Q ss_pred             EEEee--CCCCCccCcccceeeee---cCCCe-eEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEEEEeecCc
Q 000080         2295 VCTWQ--LEVGGRSNVRPMESCLC---FSSHA-MDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRASITCHEGL 2368 (2389)
Q Consensus      2295 VkLWD--l~tggrs~~k~l~tl~g---Hs~~V-~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~sL~GH~~~ 2368 (2389)
                      |.-||  ..+|.-++.+.+..+..   +.... -..+... +|.+.++.   =+.++|.--|.  .+|+.++.+.--+.+
T Consensus       182 V~a~dyd~~tG~~snr~~i~dlrk~~~~e~~~PDGm~ID~-eG~L~Va~---~ng~~V~~~dp--~tGK~L~eiklPt~q  255 (310)
T KOG4499|consen  182 VDAYDYDCPTGDLSNRKVIFDLRKSQPFESLEPDGMTIDT-EGNLYVAT---FNGGTVQKVDP--TTGKILLEIKLPTPQ  255 (310)
T ss_pred             EeeeecCCCcccccCcceeEEeccCCCcCCCCCCcceEcc-CCcEEEEE---ecCcEEEEECC--CCCcEEEEEEcCCCc
Confidence            99998  77764344344444432   12211 1244455 67766654   26788888887  588889988888999


Q ss_pred             EEEEeec
Q 000080         2369 YDLFLPL 2375 (2389)
Q Consensus      2369 V~svA~~ 2375 (2389)
                      |+|.++-
T Consensus       256 itsccFg  262 (310)
T KOG4499|consen  256 ITSCCFG  262 (310)
T ss_pred             eEEEEec
Confidence            9998874


No 411
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=30.16  E-value=75  Score=43.34  Aligned_cols=62  Identities=26%  Similarity=0.426  Sum_probs=41.7

Q ss_pred             EEEEEEcCCCCeEEEEeCCCcEEEeecCCCce--eeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEe
Q 000080         2222 TRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKA--TATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTW 2298 (2389)
Q Consensus      2222 VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~--l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLW 2298 (2389)
                      +.+|.-||-|+-+++|+.||+|+++++..-+.  +.+..+      |       -..+.|...|  |.++..|+.+--|
T Consensus        17 ~~aiqshp~~~s~v~~~~d~si~lfn~~~r~qski~~~~~------p-------~~nlv~tnhg--l~~~tsdrr~la~   80 (1636)
T KOG3616|consen   17 TTAIQSHPGGQSFVLAHQDGSIILFNFIPRRQSKICEEAK------P-------KENLVFTNHG--LVTATSDRRALAW   80 (1636)
T ss_pred             eeeeeecCCCceEEEEecCCcEEEEeecccchhhhhhhcC------C-------ccceeeeccc--eEEEeccchhhee
Confidence            37889999999999999999999999865444  333321      1       1334455555  5555555555555


No 412
>PF14655 RAB3GAP2_N:  Rab3 GTPase-activating protein regulatory subunit N-terminus
Probab=30.06  E-value=2.9e+02  Score=36.43  Aligned_cols=32  Identities=16%  Similarity=0.076  Sum_probs=28.7

Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCCCC
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLEVG 2303 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~tg 2303 (2389)
                      ..+.+|+.+|+|++.|..+.=|.|.|+|+.++
T Consensus       308 R~~~~i~~sP~~~laA~tDslGRV~LiD~~~~  339 (415)
T PF14655_consen  308 REGESICLSPSGRLAAVTDSLGRVLLIDVARG  339 (415)
T ss_pred             ceEEEEEECCCCCEEEEEcCCCcEEEEECCCC
Confidence            45899999999998888888899999999986


No 413
>PF13934 ELYS:  Nuclear pore complex assembly
Probab=29.72  E-value=3e+02  Score=33.22  Aligned_cols=160  Identities=17%  Similarity=0.136  Sum_probs=92.3

Q ss_pred             eChHHHHHHHHHHHHHHHhccCCcchhHHHHHHhcchHHHHHHHhcccCCCchhHHhHhhcccChHHHHHHHHhhHHHHh
Q 000080         1241 TDVTQLRTRMEKLARLQYLKKKDPKDCALLYIALNRIQVLAGLFKISKDEKDKPLVGFLSRNFQEEKNKAAALKNAYVLL 1320 (2389)
Q Consensus      1241 ~~~~~Lr~~~EkIAr~ey~~~kDP~dcaLfYlAL~Kk~vL~gL~k~~~~~k~~~m~~FLsnDFse~RWr~AAlKNAyaLL 1320 (2389)
                      ++.+.||+.+..|.......  .-..|-+||+.+--....           .....+=|.+.|.-++--.... -||-+|
T Consensus        24 ~s~~~L~~Ll~~i~~~~~~~--~~K~~l~~YlLlD~~~~~-----------~~~~~~~Fa~~f~ip~~~~~~~-~g~W~L   89 (226)
T PF13934_consen   24 KSDNDLRALLDLILSSNVSL--LKKHSLFYYLLLDLDDTR-----------PSELAESFARAFGIPPKYIKFI-QGFWLL   89 (226)
T ss_pred             cCHHHHHHHHHHHhcCCcCH--HHhHHHHHHHHHhcCccc-----------cccHHHHHHHHhCCCHHHHHHH-HHHHHh
Confidence            45566888776654432211  122477788776542110           0113343455555554333322 367777


Q ss_pred             hcchhHHHHHHHHhc----CChhHHHHHHHHhcCChhhhhhhhhhhccCCCh-----hhHhhHhhhccccccc-------
Q 000080         1321 GRHQLELAIAFFLLG----GDAASAVTVCARNLGDVQLALVICRLVEKHGGP-----LERNLVTKFILPSSIE------- 1384 (2389)
Q Consensus      1321 sK~Ry~~AAAFFLLA----g~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp-----~l~~lL~~~vLp~a~~------- 1384 (2389)
                      =...|+.|...+.=.    ......+++++.+ ++.++|+...|.....-..     .+..+|.+..+++|..       
T Consensus        90 D~~~~~~A~~~L~~ps~~~~~~~~Il~~L~~~-~~~~lAL~y~~~~~p~l~s~~~~~~~~~~La~~~v~EAf~~~R~~~~  168 (226)
T PF13934_consen   90 DHGDFEEALELLSHPSLIPWFPDKILQALLRR-GDPKLALRYLRAVGPPLSSPEALTLYFVALANGLVTEAFSFQRSYPD  168 (226)
T ss_pred             ChHhHHHHHHHhCCCCCCcccHHHHHHHHHHC-CChhHHHHHHHhcCCCCCCHHHHHHHHHHHHcCCHHHHHHHHHhCch
Confidence            777777776665332    2245788888886 8888888888887654221     1234566666666642       


Q ss_pred             -cCChhHHHHHHHHhCCh--hHHHHHHhcCcccc
Q 000080         1385 -RGDYWLTSLLEWELGNY--SQSFLTMLGFQSTA 1415 (2389)
Q Consensus      1385 -~gDrwL~S~a~W~L~~~--~~Av~~Ll~~p~~~ 1415 (2389)
                       .+.+-+..++.++++..  ...++.|++.|.++
T Consensus       169 ~~~~~l~e~l~~~~~~~~~~~~~~~~Ll~LPl~~  202 (226)
T PF13934_consen  169 ELRRRLFEQLLEHCLEECARSGRLDELLSLPLDE  202 (226)
T ss_pred             hhhHHHHHHHHHHHHHHhhhhhHHHHHHhCCCCh
Confidence             12346667777777533  45678899888765


No 414
>KOG2395 consensus Protein involved in vacuole import and degradation [Intracellular trafficking, secretion, and vesicular transport]
Probab=27.30  E-value=87  Score=41.83  Aligned_cols=58  Identities=17%  Similarity=0.217  Sum_probs=44.1

Q ss_pred             eEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2233 FFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2233 ~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      +||.||.+|.|||+|- .|+.-+|.  +||       =...|..|.-+.||+++.... +.++-|=++.
T Consensus       443 ~IvvgS~~GdIRLYdr-i~~~AKTA--lPg-------LG~~I~hVdvtadGKwil~Tc-~tyLlLi~t~  500 (644)
T KOG2395|consen  443 YIVVGSLKGDIRLYDR-IGRRAKTA--LPG-------LGDAIKHVDVTADGKWILATC-KTYLLLIDTL  500 (644)
T ss_pred             eEEEeecCCcEEeehh-hhhhhhhc--ccc-------cCCceeeEEeeccCcEEEEec-ccEEEEEEEe
Confidence            7888999999999995 77766664  233       337899999999999877544 5667766653


No 415
>cd00870 PI3Ka_III Phosphoinositide 3-kinase (PI3K) class III, accessory domain (PIK domain); PIK domain is conserved in all PI3 and PI4-kinases. Its role is unclear but it has been suggested to be involved in substrate presentation. In general, PI3Ks class III phosphorylate phosphoinositol (PtdIns) only. The prototypical PI3K class III, yeast Vps34, is involved in trafficking proteins from Golgi to the vacuole.
Probab=25.88  E-value=3e+02  Score=32.00  Aligned_cols=116  Identities=23%  Similarity=0.336  Sum_probs=70.4

Q ss_pred             chHHHHHHHhcccCCCchhHHhHhh-cccChHHHHHHHHhhHHHHhhcch-hHHHHHHHHhcCChhH------HHHHHHH
Q 000080         1276 RIQVLAGLFKISKDEKDKPLVGFLS-RNFQEEKNKAAALKNAYVLLGRHQ-LELAIAFFLLGGDAAS------AVTVCAR 1347 (2389)
Q Consensus      1276 Kk~vL~gL~k~~~~~k~~~m~~FLs-nDFse~RWr~AAlKNAyaLLsK~R-y~~AAAFFLLAg~lkD------AV~Vc~~ 1347 (2389)
                      .|++|+. ||-.--...+.+.+||. =|++++.    ..+.||+||.+-. ..-.-|.-||...+.|      ||+.+- 
T Consensus        30 ek~llW~-~R~~l~~~p~aL~~~L~sv~W~~~~----e~~e~~~lL~~W~~i~~~~aLeLL~~~f~~~~VR~yAV~~L~-  103 (166)
T cd00870          30 EKDLIWK-FRFYLTNNKKALTKFLKSVNWSDEQ----EVKQALELMPKWAKIDIEDALELLSPYFTNPVVRKYAVSRLK-  103 (166)
T ss_pred             HHHHHHH-hHHHHhhCcHHHHHHhhhCCCCCHH----HHHHHHHHHhcCCCCCHHHHHHHcCccCCCHHHHHHHHHHHH-
Confidence            3555554 34321111245678873 3555432    5567888887653 3455678888887765      676655 


Q ss_pred             hcCChhhhhhhhhhh-----ccC---CChhhHhhHhhhccccccccCChhHHHHHHHHhC
Q 000080         1348 NLGDVQLALVICRLV-----EKH---GGPLERNLVTKFILPSSIERGDYWLTSLLEWELG 1399 (2389)
Q Consensus      1348 ~L~D~qLAi~IaRLy-----Egd---~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~ 1399 (2389)
                      ++.|-+|...+--|.     |..   .++....-|.+++|-.|..  ++=++...||.|+
T Consensus       104 ~~sd~eL~~yL~QLVQaLKyE~~~~~~~~~~~s~La~fLl~Ral~--s~~ig~~lfW~Lk  161 (166)
T cd00870         104 LASDEELLLYLLQLVQALKYENLDLSPLPRLDSPLADFLIERALK--NPKLANFLYWYLK  161 (166)
T ss_pred             hCCHHHHHHHHHHHHHHHHhcccccccccccccHHHHHHHHHHhc--CHHHHHHHHHHhh
Confidence            589998888776664     432   1122334566666666654  4559999999885


No 416
>KOG2377 consensus Uncharacterized conserved protein [Function unknown]
Probab=25.60  E-value=1.7e+02  Score=38.71  Aligned_cols=30  Identities=17%  Similarity=0.133  Sum_probs=28.1

Q ss_pred             CCEEEEEECCCCCEEEEEeCCCcEEEeeCC
Q 000080         2272 ASISALQFDHYGHRFASAALDGTVCTWQLE 2301 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~DgTVkLWDl~ 2301 (2389)
                      +.|.+|.||||.+.||.--.|++|.+.+..
T Consensus        67 G~I~SIkFSlDnkilAVQR~~~~v~f~nf~   96 (657)
T KOG2377|consen   67 GEIKSIKFSLDNKILAVQRTSKTVDFCNFI   96 (657)
T ss_pred             CceeEEEeccCcceEEEEecCceEEEEecC
Confidence            579999999999999999999999999883


No 417
>PF10313 DUF2415:  Uncharacterised protein domain (DUF2415);  InterPro: IPR019417  This entry represents a short (30 residues) domain of unknown function found in a family of fungal proteins. It contains a characteristic DLL sequence motif. 
Probab=25.36  E-value=1.3e+02  Score=28.16  Aligned_cols=31  Identities=6%  Similarity=0.105  Sum_probs=25.7

Q ss_pred             eEEEEEEcCCC---CeEEEEeCCCcEEEeecCCC
Q 000080         2221 STRAFSSHPLR---PFFLVGSSNTHIYLWEFGKD 2251 (2389)
Q Consensus      2221 ~VrsVAFsPdG---~~LASGS~DgTIRLWDl~tG 2251 (2389)
                      .||.+.|+|+.   .+||-+=.-+.|-|+|++++
T Consensus         2 AvR~~kFsP~~~~~DLL~~~E~~g~vhi~D~R~~   35 (43)
T PF10313_consen    2 AVRCCKFSPEPGGNDLLAWAEHQGRVHIVDTRSN   35 (43)
T ss_pred             CeEEEEeCCCCCcccEEEEEccCCeEEEEEcccC
Confidence            46999999854   48888888899999999854


No 418
>PF11715 Nup160:  Nucleoporin Nup120/160;  InterPro: IPR021717  Nup120 is conserved from fungi to plants to humans, and is homologous with the Nup160 of vertebrates. The nuclear core complex, or NPC, mediates macromolecular transport across the nuclear envelope. Deletion of the NUP120 gene causes clustering of NPCs at one side of the nuclear envelope, moderate nucleolar fragmentation and slower cell growth []. The vertebrate NPC is estimated to contain between 30 and 60 different proteins. most of which are not known. Two important ones in creating the nucleoporin basket are Nup98 and Nup153, and Nup120, in conjunction with Nup 133, interacts with these two and itself plays a role in mRNA export []. Nup160, Nup133, Nup96, and Nup107 are all targets of phosphorylation. The phosphorylation sites are clustered mainly at the N-terminal regions of these proteins, which are predicted to be natively disordered. The entire Nup107-160 subcomplex is stable throughout the cell cycle, thus it seems unlikely that phosphorylation affects interactions within the Nup107-160 subcomplex, but rather that it regulates the association of the subcomplex with the NPC and other proteins []. ; PDB: 3F7F_D 3H7N_D 3HXR_A.
Probab=25.15  E-value=1e+02  Score=40.97  Aligned_cols=33  Identities=21%  Similarity=0.313  Sum_probs=25.2

Q ss_pred             CCEEEEEECC----CCCEEEEEeCCCcEEEeeCCCCC
Q 000080         2272 ASISALQFDH----YGHRFASAALDGTVCTWQLEVGG 2304 (2389)
Q Consensus      2272 ~~V~sVaFSP----DG~~LASgS~DgTVkLWDl~tgg 2304 (2389)
                      +.+.++++++    +...+++.+.|+++|+||++++.
T Consensus       215 ~~~~~~~~~~~~~~~~~~l~tl~~D~~LRiW~l~t~~  251 (547)
T PF11715_consen  215 SVAASLAVSSSEINDDTFLFTLSRDHTLRIWSLETGQ  251 (547)
T ss_dssp             --EEEEEE-----ETTTEEEEEETTSEEEEEETTTTC
T ss_pred             CccceEEEecceeCCCCEEEEEeCCCeEEEEECCCCe
Confidence            3466677777    67899999999999999999873


No 419
>KOG4659 consensus Uncharacterized conserved protein (Rhs family) [Function unknown]
Probab=24.84  E-value=2.8e+02  Score=40.79  Aligned_cols=16  Identities=19%  Similarity=0.295  Sum_probs=7.1

Q ss_pred             cccccCceEEEEecCe
Q 000080          894 FTWGRRAIAIVVHQSY  909 (2389)
Q Consensus       894 ssWVRDGILVVGmgnE  909 (2389)
                      +.-.+||-|.||--|.
T Consensus       370 la~a~DGSl~VGDfNy  385 (1899)
T KOG4659|consen  370 LAYAPDGSLIVGDFNY  385 (1899)
T ss_pred             EEEcCCCcEEEccchh
Confidence            3444444444444444


No 420
>KOG3616 consensus Selective LIM binding factor [Transcription]
Probab=24.31  E-value=2e+02  Score=39.69  Aligned_cols=134  Identities=20%  Similarity=0.266  Sum_probs=76.4

Q ss_pred             HhhcchhHHHHHHHHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhhHhhHhhhccccccccCChhHHHHHHHH-
Q 000080         1319 LLGRHQLELAIAFFLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLERNLVTKFILPSSIERGDYWLTSLLEWE- 1397 (2389)
Q Consensus      1319 LLsK~Ry~~AAAFFLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~- 1397 (2389)
                      ||.-+|-..|.-+|+=|+-.-||+.+|-+||.. |+ -+|.--|            ++.-+....+.-|-|.+---.|. 
T Consensus      1102 llrankp~i~l~yf~e~~lw~dalri~kdylp~-q~-a~iqeey------------ek~~~k~gargvd~fvaqak~weq 1167 (1636)
T KOG3616|consen 1102 LLRANKPDIALNYFIEAELWPDALRIAKDYLPH-QA-AAIQEEY------------EKEALKKGARGVDGFVAQAKEWEQ 1167 (1636)
T ss_pred             eeecCCCchHHHHHHHhccChHHHHHHHhhChh-HH-HHHHHHH------------HHHHHhccccccHHHHHHHHHHHh
Confidence            556666667777777777777777777777654 22 2222223            22233334444466888777885 


Q ss_pred             hCChhHHHHHHhcCccccccccccccCCCccCCChHHHHHHHHhhccccchhhhccchhhhhHHHHHHHHHH-HHHhcCC
Q 000080         1398 LGNYSQSFLTMLGFQSTAVINNFALSSNSVAFMDPSIGLYCLMLANKNSMRNAIGEKNAAILGRWAALMRAT-ALNRCGL 1476 (2389)
Q Consensus      1398 L~~~~~Av~~Ll~~p~~~~~~~s~l~s~~~~f~DPaL~l~~~~L~sk~~~r~~~g~~~~~~~~r~~~l~~a~-~l~RmGC 1476 (2389)
                      -|++..||.+||+...+.             ++.-+|+-.|..-+..-+++-..|..+      -+++..|- +|+..||
T Consensus      1168 ~gd~rkav~~~lkinrds-------------t~nd~l~e~~~~kaadl~ikfl~~d~n------me~i~aa~~al~~~~~ 1228 (1636)
T KOG3616|consen 1168 AGDWRKAVDALLKINRDS-------------TDNDALAEHCTEKAADLSIKFLMGDEN------MEVIGAAGGALDEAGC 1228 (1636)
T ss_pred             cccHHHHHHHHhhhccCC-------------CCcHHHHHHHHHHHHhhhhhhcCCccc------hhhHHhcchhhhcccc
Confidence            699999999999754322             233344444433222222333334222      23344333 3788999


Q ss_pred             Chhhhhccc
Q 000080         1477 PLEALDCLS 1485 (2389)
Q Consensus      1477 ~lLALdll~ 1485 (2389)
                      +--|-||+-
T Consensus      1229 ~e~aael~l 1237 (1636)
T KOG3616|consen 1229 HEAAAELLL 1237 (1636)
T ss_pred             cHHHHHHHH
Confidence            987777764


No 421
>KOG1897 consensus Damage-specific DNA binding complex, subunit DDB1 [Replication, recombination and repair]
Probab=23.49  E-value=4.1e+02  Score=38.32  Aligned_cols=150  Identities=12%  Similarity=0.035  Sum_probs=0.0

Q ss_pred             eEEEEEEcCCCCeEEEEeCCCcEEEeecCCCcee--------eEecccCCCCCCCCCCCCCEEEEEECCC-CCEEEEEeC
Q 000080         2221 STRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKAT--------ATYGVLPAANVPPPYALASISALQFDHY-GHRFASAAL 2291 (2389)
Q Consensus      2221 ~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l--------~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-G~~LASgS~ 2291 (2389)
                      +.|+|++++...+++.-+.-...+.=..+....+        .||+++..|..-..-..-.|.++.|.-| +.+++.|..
T Consensus       716 ~prrI~~q~~sl~~~v~s~r~e~~~~~~~ee~~~s~l~vlD~nTf~vl~~hef~~~E~~~Si~s~~~~~d~~t~~vVGT~  795 (1096)
T KOG1897|consen  716 SPRRICYQESSLTFGVLSNRIESSAEYYGEEYEVSFLRVLDQNTFEVLSSHEFERNETALSIISCKFTDDPNTYYVVGTG  795 (1096)
T ss_pred             ChhheEecccceEEEEEecccccchhhcCCcceEEEEEEecCCceeEEeeccccccceeeeeeeeeecCCCceEEEEEEE


Q ss_pred             ----------CCcEEEeeCCCCCccCcccceeeeecCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeCCCCCCCceEE
Q 000080         2292 ----------DGTVCTWQLEVGGRSNVRPMESCLCFSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDTLAPPTSSRAS 2361 (2389)
Q Consensus      2292 ----------DgTVkLWDl~tggrs~~k~l~tl~gHs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~l~~tg~~v~s 2361 (2389)
                                .|.|-+...+.+     +.++....|.-...-.+..--+|++||.     -+..|||++.  .+.+.++.
T Consensus       796 ~v~Pde~ep~~GRIivfe~~e~-----~~L~~v~e~~v~Gav~aL~~fngkllA~-----In~~vrLye~--t~~~eLr~  863 (1096)
T KOG1897|consen  796 LVYPDENEPVNGRIIVFEFEEL-----NSLELVAETVVKGAVYALVEFNGKLLAG-----INQSVRLYEW--TTERELRI  863 (1096)
T ss_pred             eeccCCCCcccceEEEEEEecC-----CceeeeeeeeeccceeehhhhCCeEEEe-----cCcEEEEEEc--cccceehh


Q ss_pred             EEeecCcEEEEeecccchhhh
Q 000080         2362 ITCHEGLYDLFLPLKLLNFAL 2382 (2389)
Q Consensus      2362 L~GH~~~V~svA~~~~~~~~~ 2382 (2389)
                      =..|.+.+..+.....||++.
T Consensus       864 e~~~~~~~~aL~l~v~gdeI~  884 (1096)
T KOG1897|consen  864 ECNISNPIIALDLQVKGDEIA  884 (1096)
T ss_pred             hhcccCCeEEEEEEecCcEEE


No 422
>PRK11447 cellulose synthase subunit BcsC; Provisional
Probab=23.25  E-value=6.9e+02  Score=36.87  Aligned_cols=77  Identities=12%  Similarity=0.122  Sum_probs=44.9

Q ss_pred             HHhcCChhHHHHHHHHhcCChhhhhhhhhhhccCCChhh-HhhHhhhccccccccCCh-hHHHHHHHHhCChhHHHHHHh
Q 000080         1332 FLLGGDAASAVTVCARNLGDVQLALVICRLVEKHGGPLE-RNLVTKFILPSSIERGDY-WLTSLLEWELGNYSQSFLTML 1409 (2389)
Q Consensus      1332 FLLAg~lkDAV~Vc~~~L~D~qLAi~IaRLyEgd~gp~l-~~lL~~~vLp~a~~~gDr-wL~S~a~W~L~~~~~Av~~Ll 1409 (2389)
                      .+-.|+.++|++++-++-.+.++-+.++.+|+..+..-. ...+ +.++...-...+. .-...+|..+|++++|++.+-
T Consensus       583 l~~~G~~~eA~~~l~~~p~~~~~~~~La~~~~~~g~~~~A~~~y-~~al~~~P~~~~a~~~la~~~~~~g~~~eA~~~l~  661 (1157)
T PRK11447        583 LRDSGKEAEAEALLRQQPPSTRIDLTLADWAQQRGDYAAARAAY-QRVLTREPGNADARLGLIEVDIAQGDLAAARAQLA  661 (1157)
T ss_pred             HHHCCCHHHHHHHHHhCCCCchHHHHHHHHHHHcCCHHHHHHHH-HHHHHhCCCCHHHHHHHHHHHHHCCCHHHHHHHHH
Confidence            344567778888777777777777777777765332111 1112 2222222222232 334456889999999997665


No 423
>PRK10370 formate-dependent nitrite reductase complex subunit NrfG; Provisional
Probab=23.19  E-value=5.3e+02  Score=30.32  Aligned_cols=74  Identities=15%  Similarity=0.178  Sum_probs=41.4

Q ss_pred             CChhHHHHHHHHhc----CChhhhhhhhhh-h-ccCC--ChhhHhhHhhhccccccccCChhHHHHHHHHhCChhHHHHH
Q 000080         1336 GDAASAVTVCARNL----GDVQLALVICRL-V-EKHG--GPLERNLVTKFILPSSIERGDYWLTSLLEWELGNYSQSFLT 1407 (2389)
Q Consensus      1336 g~lkDAV~Vc~~~L----~D~qLAi~IaRL-y-Egd~--gp~l~~lL~~~vLp~a~~~gDrwL~S~a~W~L~~~~~Av~~ 1407 (2389)
                      |+.++|+..+-+=+    +|.++...++.+ | ..++  .+--.+++++.+--....-.-.++...++-.+|+|++|+..
T Consensus        87 g~~~~A~~a~~~Al~l~P~~~~~~~~lA~aL~~~~g~~~~~~A~~~l~~al~~dP~~~~al~~LA~~~~~~g~~~~Ai~~  166 (198)
T PRK10370         87 NDYDNALLAYRQALQLRGENAELYAALATVLYYQAGQHMTPQTREMIDKALALDANEVTALMLLASDAFMQADYAQAIEL  166 (198)
T ss_pred             CCHHHHHHHHHHHHHhCCCCHHHHHHHHHHHHHhcCCCCcHHHHHHHHHHHHhCCCChhHHHHHHHHHHHcCCHHHHHHH
Confidence            44555555444322    366666666653 2 3222  13345555554433222223357888888999999999976


Q ss_pred             Hh
Q 000080         1408 ML 1409 (2389)
Q Consensus      1408 Ll 1409 (2389)
                      +-
T Consensus       167 ~~  168 (198)
T PRK10370        167 WQ  168 (198)
T ss_pred             HH
Confidence            53


No 424
>PF05787 DUF839:  Bacterial protein of unknown function (DUF839);  InterPro: IPR008557 This family consists of bacterial proteins of unknown function.
Probab=22.67  E-value=7.2e+02  Score=33.84  Aligned_cols=57  Identities=28%  Similarity=0.499  Sum_probs=33.2

Q ss_pred             cCCCCchhhh--hcccceeeeeeccc------CCCcceEEeecccceEEeeecccccccccccceec
Q 000080         2068 IPFQAPKEIC--KRNGELFEALCVNS------IDQRQGAIASNRKGIVFFNLEDEIPLHDQLKYIWA 2126 (2389)
Q Consensus      2068 ~~f~~~~~~~--~~~~~~~~a~~~n~------~n~~~~~~a~~~k~~~~~~~~~~~~~~~~~~~~~~ 2126 (2389)
                      +.|.+|+-|.  ..+|++--|+.=|+      ++.... .+.|+-|.||- |.....-.....+.|.
T Consensus       347 T~f~RpEgi~~~p~~g~vY~a~T~~~~r~~~~~~~~n~-~~~n~~G~I~r-~~~~~~d~~~~~f~~~  411 (524)
T PF05787_consen  347 TPFDRPEGITVNPDDGEVYFALTNNSGRGESDVDAANP-RAGNGYGQIYR-YDPDGNDHAATTFTWE  411 (524)
T ss_pred             ccccCccCeeEeCCCCEEEEEEecCCCCcccccccCCc-ccCCcccEEEE-ecccCCccccceeEEE
Confidence            5799999887  88888888887666      111111 25577787743 3333322233335554


No 425
>PRK10115 protease 2; Provisional
Probab=22.62  E-value=4.4e+02  Score=36.79  Aligned_cols=101  Identities=7%  Similarity=-0.053  Sum_probs=57.4

Q ss_pred             CCEEEEEECCCCCEEEEEeC-----CCcEEEeeCCCCCccCcccc-eeeeecCCCeeEEEEecCCCCEEEEeecCC---C
Q 000080         2272 ASISALQFDHYGHRFASAAL-----DGTVCTWQLEVGGRSNVRPM-ESCLCFSSHAMDVSYITSSGSVIAAAGHSS---N 2342 (2389)
Q Consensus      2272 ~~V~sVaFSPDG~~LASgS~-----DgTVkLWDl~tggrs~~k~l-~tl~gHs~~V~sVAFSP~DGslLASAG~sS---~ 2342 (2389)
                      -.+..+.+||||++||-+.+     .-+|++=|+.+|.     .+ ..+.   ..-..++|.+ ||+.|.-+....   .
T Consensus       127 ~~l~~~~~Spdg~~la~~~d~~G~E~~~l~v~d~~tg~-----~l~~~i~---~~~~~~~w~~-D~~~~~y~~~~~~~~~  197 (686)
T PRK10115        127 YTLGGMAITPDNTIMALAEDFLSRRQYGIRFRNLETGN-----WYPELLD---NVEPSFVWAN-DSWTFYYVRKHPVTLL  197 (686)
T ss_pred             EEEeEEEECCCCCEEEEEecCCCcEEEEEEEEECCCCC-----CCCcccc---CcceEEEEee-CCCEEEEEEecCCCCC
Confidence            34677899999998887543     3567788888762     11 1111   1124699999 777665433210   1


Q ss_pred             CCeEEEeeCCCCCC--CceEEEEeecCcEE-EEeecccchhhhc
Q 000080         2343 GINVVVWDTLAPPT--SSRASITCHEGLYD-LFLPLKLLNFALS 2383 (2389)
Q Consensus      2343 D~TVrLWD~l~~tg--~~v~sL~GH~~~V~-svA~~~~~~~~~s 2383 (2389)
                      ...|..+++  .++  +...-+++..+... .+..+++++|.+-
T Consensus       198 ~~~v~~h~l--gt~~~~d~lv~~e~~~~~~~~~~~s~d~~~l~i  239 (686)
T PRK10115        198 PYQVWRHTI--GTPASQDELVYEEKDDTFYVSLHKTTSKHYVVI  239 (686)
T ss_pred             CCEEEEEEC--CCChhHCeEEEeeCCCCEEEEEEEcCCCCEEEE
Confidence            135777776  344  33334444334344 4445557877653


No 426
>PF07676 PD40:  WD40-like Beta Propeller Repeat;  InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=22.38  E-value=1.2e+02  Score=26.10  Aligned_cols=22  Identities=14%  Similarity=0.126  Sum_probs=16.6

Q ss_pred             ccceEEEEeecCCCCeEEEEec
Q 000080          144 QGTKVEAIEWTGSGDGIVAGGM  165 (2389)
Q Consensus       144 hssTV~sIAWSpdG~rLaSggd  165 (2389)
                      ....-...+|||||++|+-++.
T Consensus         7 ~~~~~~~p~~SpDGk~i~f~s~   28 (39)
T PF07676_consen    7 SPGDDGSPAWSPDGKYIYFTSN   28 (39)
T ss_dssp             SSSSEEEEEE-TTSSEEEEEEE
T ss_pred             CCccccCEEEecCCCEEEEEec
Confidence            3446688999999999996665


No 427
>PF08728 CRT10:  CRT10;  InterPro: IPR014839 CRT10 is a transcriptional regulator of ribonucleotide reductase (RNR) genes []. RNR catalyses the rate limiting step in dNTP synthesis. Mutations in CRT10 have been shown to enhance hydroxyurea resistance []. 
Probab=21.37  E-value=2e+02  Score=40.10  Aligned_cols=74  Identities=19%  Similarity=0.354  Sum_probs=54.5

Q ss_pred             eeEEEEEEc--CCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCC-----CC-EEEEEeC
Q 000080         2220 ISTRAFSSH--PLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHY-----GH-RFASAAL 2291 (2389)
Q Consensus      2220 i~VrsVAFs--PdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPD-----G~-~LASgS~ 2291 (2389)
                      .++|.+++|  ...++||.++.-..|.+|-+..... +.+. .+.|     -|.+-|-+|.|-++     |. ++++++-
T Consensus       164 ~SaWGLdIh~~~~~rlIAVSsNs~~VTVFaf~l~~~-r~~~-~~s~-----~~~hNIP~VSFl~~~~d~~G~v~v~a~dI  236 (717)
T PF08728_consen  164 ASAWGLDIHDYKKSRLIAVSSNSQEVTVFAFALVDE-RFYH-VPSH-----QHSHNIPNVSFLDDDLDPNGHVKVVATDI  236 (717)
T ss_pred             CceeEEEEEecCcceEEEEecCCceEEEEEEecccc-cccc-cccc-----ccccCCCeeEeecCCCCCccceEEEEEec
Confidence            377999999  8899999999999999998865321 1111 0112     13456888888654     33 8999999


Q ss_pred             CCcEEEeeC
Q 000080         2292 DGTVCTWQL 2300 (2389)
Q Consensus      2292 DgTVkLWDl 2300 (2389)
                      .|.+-+|++
T Consensus       237 ~G~v~~~~I  245 (717)
T PF08728_consen  237 SGEVWTFKI  245 (717)
T ss_pred             cCcEEEEEE
Confidence            999999888


No 428
>TIGR02917 PEP_TPR_lipo putative PEP-CTERM system TPR-repeat lipoprotein. This protein family occurs in strictly within a subset of Gram-negative bacterial species with the proposed PEP-CTERM/exosortase system, analogous to the LPXTG/sortase system common in Gram-positive bacteria. This protein occurs in a species if and only if a transmembrane histidine kinase (TIGR02916) and a DNA-binding response regulator (TIGR02915) also occur. The present of tetratricopeptide repeats (TPR) suggests protein-protein interaction, possibly for the regulation of PEP-CTERM protein expression, since many PEP-CTERM proteins in these genomes are preceded by a proposed DNA binding site for the response regulator.
Probab=21.23  E-value=8.2e+02  Score=33.15  Aligned_cols=65  Identities=18%  Similarity=0.217  Sum_probs=38.8

Q ss_pred             HHHHHHHHHHhcCCChhhhhcccCCCCCCCCCCccccccCCCcccccccccCCCCCCCccccccccccccccccccccHH
Q 000080         1463 AALMRATALNRCGLPLEALDCLSSSPSTIGGTDQESVLNIGHSHILPEILKPSAATGSSNWLLRDVALHLESCAKLDLSL 1542 (2389)
Q Consensus      1463 ~~l~~a~~l~RmGC~lLALdll~~s~~~~~~~~~~s~~~~~~~~~~~~~~~~~~~~~~~nw~~~~~~~~~~~~~~~~~~~ 1542 (2389)
                      .....+..+.+.|-.-.|++.+.+.+..                      .|...   .-|+  ..+..+-...+.+.|.
T Consensus       195 ~~~~~~~~~~~~g~~~~A~~~~~~a~~~----------------------~p~~~---~~~~--~~~~~~~~~g~~~~A~  247 (899)
T TIGR02917       195 ALLLKGDLLLSLGNIELALAAYRKAIAL----------------------RPNNP---AVLL--ALATILIEAGEFEEAE  247 (899)
T ss_pred             HHHHHHHHHHhcCCHHHHHHHHHHHHhh----------------------CCCCH---HHHH--HHHHHHHHcCCHHHHH
Confidence            4455566678888888888888764321                      11100   0111  1222233456788888


Q ss_pred             HHHHHHhhcCCC
Q 000080         1543 QYFSKLIRDHPS 1554 (2389)
Q Consensus      1543 ~~~s~~~~~~~~ 1554 (2389)
                      +++.++++..|.
T Consensus       248 ~~~~~~~~~~~~  259 (899)
T TIGR02917       248 KHADALLKKAPN  259 (899)
T ss_pred             HHHHHHHHhCCC
Confidence            888888887764


No 429
>PF07676 PD40:  WD40-like Beta Propeller Repeat;  InterPro: IPR011659 WD-40 repeats (also known as WD or beta-transducin repeats) are short ~40 amino acid motifs, often terminating in a Trp-Asp (W-D) dipeptide. WD40 repeats usually assume a 7-8 bladed beta-propeller fold, but proteins have been found with 4 to 16 repeated units, which also form a circularised beta-propeller structure. WD-repeat proteins are a large family found in all eukaryotes and are implicated in a variety of functions ranging from signal transduction and transcription regulation to cell cycle control and apoptosis. Repeated WD40 motifs act as a site for protein-protein interaction, and proteins containing WD40 repeats are known to serve as platforms for the assembly of protein complexes or mediators of transient interplay among other proteins. The specificity of the proteins is determined by the sequences outside the repeats themselves. Examples of such complexes are G proteins (beta subunit is a beta-propeller), TAFII transcription factor, and E3 ubiquitin ligase [, ]. In Arabidopsis spp., several WD40-containing proteins act as key regulators of plant-specific developmental events. This region appears to be related to the IPR001680 from INTERPRO repeat. This model is likely to miss copies within a sequence.; PDB: 2HQS_D 1C5K_A 2IVZ_A 2W8B_D 3IAX_A 1CRZ_A 1N6F_D 1N6D_C 1N6E_C 1K32_A ....
Probab=21.07  E-value=2.2e+02  Score=24.62  Aligned_cols=30  Identities=7%  Similarity=0.067  Sum_probs=20.0

Q ss_pred             cCCCeeEEEEecCCCCEEEEeecCCCC--CeEEEe
Q 000080         2317 FSSHAMDVSYITSSGSVIAAAGHSSNG--INVVVW 2349 (2389)
Q Consensus      2317 Hs~~V~sVAFSP~DGslLASAG~sS~D--~TVrLW 2349 (2389)
                      ....-...+||| ||+.|+-++  ..+  +.-.||
T Consensus         7 ~~~~~~~p~~Sp-DGk~i~f~s--~~~~~g~~diy   38 (39)
T PF07676_consen    7 SPGDDGSPAWSP-DGKYIYFTS--NRNDRGSFDIY   38 (39)
T ss_dssp             SSSSEEEEEE-T-TSSEEEEEE--ECT--SSEEEE
T ss_pred             CCccccCEEEec-CCCEEEEEe--cCCCCCCcCEE
Confidence            345566789999 999999764  344  555555


No 430
>PRK13615 lipoprotein LpqB; Provisional
Probab=20.86  E-value=6e+02  Score=34.92  Aligned_cols=114  Identities=11%  Similarity=0.021  Sum_probs=62.1

Q ss_pred             eeEEEEEEcCCCCeEEEEeCCCcEEEeecCCCceeeEecccCCCCCCCCCCCCCEEEEEECCCCCEEEEEeCCCcEEEee
Q 000080         2220 ISTRAFSSHPLRPFFLVGSSNTHIYLWEFGKDKATATYGVLPAANVPPPYALASISALQFDHYGHRFASAALDGTVCTWQ 2299 (2389)
Q Consensus      2220 i~VrsVAFsPdG~~LASGS~DgTIRLWDl~tGk~l~Tl~vl~gh~~p~~GH~~~V~sVaFSPDG~~LASgS~DgTVkLWD 2299 (2389)
                      +...+.+.+++|+.+|.-..++.++++..+ +.....+   .+.         ..+.=.|+++| .+=++..+...++..
T Consensus       334 ~~~~s~avS~dg~~~A~v~~~~~l~vg~~~-~~~~~~~---~~~---------~Lt~PS~d~~g-~vWtv~~g~~~~l~~  399 (557)
T PRK13615        334 LQADAATLSADGRQAAVRNASGVWSVGDGD-RDAVLLD---TRP---------GLVAPSLDAQG-YVWSTPASDPRGLVA  399 (557)
T ss_pred             cccccceEcCCCceEEEEcCCceEEEecCC-Ccceeec---cCC---------ccccCcCcCCC-CEEEEeCCCceEEEE
Confidence            344778999999999988888889998765 3322222   122         23333455555 222322323344444


Q ss_pred             CCCCCccCcccceeeee-cCCCeeEEEEecCCCCEEEEeecCCCCCeEEEeeC
Q 000080         2300 LEVGGRSNVRPMESCLC-FSSHAMDVSYITSSGSVIAAAGHSSNGINVVVWDT 2351 (2389)
Q Consensus      2300 l~tggrs~~k~l~tl~g-Hs~~V~sVAFSP~DGslLASAG~sS~D~TVrLWD~ 2351 (2389)
                      ....+.  ...+ .... -.+.|.++..|+ ||.++|----...+++|.|=-+
T Consensus       400 ~~~~G~--~~~v-~v~~~~~~~I~~lrvSr-DG~R~Avi~~~~g~~~V~va~V  448 (557)
T PRK13615        400 WGPDGV--GHPV-AVSWTATGRVVSLEVAR-DGARVLVQLETGAGPQLLVASI  448 (557)
T ss_pred             ecCCCc--eEEe-eccccCCCeeEEEEeCC-CccEEEEEEecCCCCEEEEEEE
Confidence            332111  0111 1111 225799999999 9998886321123456666554


No 431
>PHA02713 hypothetical protein; Provisional
Probab=20.16  E-value=9.5e+02  Score=32.75  Aligned_cols=85  Identities=13%  Similarity=0.097  Sum_probs=44.5

Q ss_pred             eeeccccccccccccccCCCCcCceeEEEEEEcCCCCeEEEEeCCC-----cEEEeecCCCceeeEecccCCCCCCCCCC
Q 000080         2196 ASALGWETQDDFEDYVDPPATVENISTRAFSSHPLRPFFLVGSSNT-----HIYLWEFGKDKATATYGVLPAANVPPPYA 2270 (2389)
Q Consensus      2196 Asg~~~d~~~~~~~~~d~~atv~ni~VrsVAFsPdG~~LASGS~Dg-----TIRLWDl~tGk~l~Tl~vl~gh~~p~~GH 2270 (2389)
                      .++.-||.....|....+......   ...+..-+|+++|.||.|+     +|..||..+++=.. ..     .||.+  
T Consensus       320 ~~v~~Yd~~~n~W~~~~~m~~~R~---~~~~~~~~g~IYviGG~~~~~~~~sve~Ydp~~~~W~~-~~-----~mp~~--  388 (557)
T PHA02713        320 NKVYKINIENKIHVELPPMIKNRC---RFSLAVIDDTIYAIGGQNGTNVERTIECYTMGDDKWKM-LP-----DMPIA--  388 (557)
T ss_pred             ceEEEEECCCCeEeeCCCCcchhh---ceeEEEECCEEEEECCcCCCCCCceEEEEECCCCeEEE-CC-----CCCcc--
Confidence            344556666666654332222111   1122334688999999764     48889987664211 11     12211  


Q ss_pred             CCCEEEEEECCCCCEEEEEeCCC
Q 000080         2271 LASISALQFDHYGHRFASAALDG 2293 (2389)
Q Consensus      2271 ~~~V~sVaFSPDG~~LASgS~Dg 2293 (2389)
                      ......++  -+|+..+.|+.++
T Consensus       389 r~~~~~~~--~~g~IYviGG~~~  409 (557)
T PHA02713        389 LSSYGMCV--LDQYIYIIGGRTE  409 (557)
T ss_pred             cccccEEE--ECCEEEEEeCCCc
Confidence            11122233  3799999998763


Done!