Query 007588
Match_columns 597
No_of_seqs 301 out of 1443
Neff 5.6
Searched_HMMs 46136
Date Thu Mar 28 12:39:26 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/007588.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/007588hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PLN02829 Probable galacturonos 100.0 8E-156 2E-160 1268.4 46.1 585 4-596 1-638 (639)
2 PLN02718 Probable galacturonos 100.0 2E-155 5E-160 1267.8 48.3 589 1-596 1-602 (603)
3 PLN02910 polygalacturonate 4-a 100.0 5E-125 1E-129 1025.0 37.9 440 154-596 192-656 (657)
4 PLN02769 Probable galacturonos 100.0 4E-122 9E-127 1010.0 42.8 433 154-596 176-629 (629)
5 PLN02742 Probable galacturonos 100.0 2E-122 5E-127 997.6 39.6 439 155-596 70-534 (534)
6 PLN02523 galacturonosyltransfe 100.0 3E-106 7E-111 872.1 38.6 437 157-597 80-559 (559)
7 PLN02870 Probable galacturonos 100.0 1E-105 3E-110 865.1 31.7 406 182-596 87-531 (533)
8 PLN02659 Probable galacturonos 100.0 3E-104 8E-109 854.5 32.4 406 182-596 87-532 (534)
9 PLN02867 Probable galacturonos 100.0 6E-104 1E-108 855.3 30.0 405 192-596 93-534 (535)
10 cd06429 GT8_like_1 GT8_like_1 100.0 1.3E-55 2.8E-60 449.7 22.3 246 308-584 1-257 (257)
11 PRK15171 lipopolysaccharide 1, 100.0 1.7E-44 3.7E-49 380.8 22.9 262 305-591 23-293 (334)
12 cd06431 GT8_LARGE_C LARGE cata 100.0 1.3E-41 2.8E-46 350.9 22.2 263 308-592 3-277 (280)
13 cd00505 Glyco_transf_8 Members 100.0 2.1E-40 4.5E-45 334.3 21.2 237 308-568 1-245 (246)
14 cd04194 GT8_A4GalT_like A4GalT 100.0 5.8E-40 1.3E-44 330.2 19.7 238 308-569 1-248 (248)
15 COG1442 RfaJ Lipopolysaccharid 100.0 1E-38 2.2E-43 334.1 21.1 259 307-591 2-268 (325)
16 PF01501 Glyco_transf_8: Glyco 100.0 2.7E-36 5.8E-41 297.9 17.0 245 309-570 1-249 (250)
17 cd06430 GT8_like_2 GT8_like_2 100.0 2.2E-32 4.7E-37 283.8 20.1 247 312-586 6-276 (304)
18 cd06432 GT8_HUGT1_C_like The C 100.0 1.6E-32 3.5E-37 278.9 17.3 229 308-563 1-240 (248)
19 cd02537 GT8_Glycogenin Glycoge 99.9 3.6E-26 7.8E-31 230.7 19.4 217 312-583 6-237 (240)
20 PLN00176 galactinol synthase 99.9 4.6E-24 1E-28 224.5 20.6 244 308-584 23-292 (333)
21 cd06914 GT8_GNT1 GNT1 is a fun 99.8 8.3E-18 1.8E-22 173.6 17.0 142 393-571 75-242 (278)
22 KOG1879 UDP-glucose:glycoprote 99.2 7.7E-11 1.7E-15 137.7 9.4 256 303-583 1177-1443(1470)
23 COG5597 Alpha-N-acetylglucosam 98.1 1.5E-06 3.2E-11 90.2 1.8 154 398-572 155-341 (368)
24 PF03407 Nucleotid_trans: Nucl 95.2 0.07 1.5E-06 52.6 8.0 141 395-563 48-202 (212)
25 PLN03182 xyloglucan 6-xylosylt 94.0 0.46 9.9E-06 52.2 11.2 164 391-581 178-376 (429)
26 PF11051 Mannosyl_trans3: Mann 92.9 0.34 7.4E-06 50.4 7.8 108 310-435 4-114 (271)
27 PF05637 Glyco_transf_34: gala 86.5 0.42 9.1E-06 48.9 2.2 97 395-494 61-160 (239)
28 cd02514 GT13_GLCNAC-TI GT13_GL 82.4 6.2 0.00014 42.6 8.9 114 309-433 3-119 (334)
29 COG4575 ElaB Uncharacterized c 79.5 8.1 0.00018 34.9 7.1 75 184-260 11-86 (104)
30 PF03071 GNT-I: GNT-I family; 78.5 7.9 0.00017 43.3 8.3 117 307-433 94-213 (434)
31 cd02515 Glyco_transf_6 Glycosy 74.8 79 0.0017 33.4 13.9 194 307-540 35-247 (271)
32 PLN03181 glycosyltransferase; 74.1 14 0.00031 41.1 8.6 36 391-427 179-214 (453)
33 KOG1950 Glycosyl transferase, 73.9 3.7 8E-05 44.6 4.2 153 409-570 122-289 (369)
34 PF03414 Glyco_transf_6: Glyco 72.7 61 0.0013 35.2 12.7 199 308-539 101-311 (337)
35 PRK10132 hypothetical protein; 67.3 32 0.00069 31.4 8.0 76 184-261 15-90 (108)
36 PF04488 Gly_transf_sug: Glyco 66.0 4.2 9.1E-05 35.8 2.1 36 393-432 61-97 (103)
37 cd00761 Glyco_tranf_GTA_type G 60.0 98 0.0021 26.5 9.8 95 311-431 3-97 (156)
38 KOG1928 Alpha-1,4-N-acetylgluc 56.1 5.6 0.00012 43.6 1.3 33 397-433 227-259 (409)
39 PF00535 Glycos_transf_2: Glyc 55.8 1.1E+02 0.0025 26.9 9.7 96 313-434 6-102 (169)
40 cd04186 GT_2_like_c Subfamily 52.2 1.6E+02 0.0036 26.1 10.2 86 319-433 11-97 (166)
41 PF10819 DUF2564: Protein of u 50.1 89 0.0019 27.0 7.3 69 188-257 6-78 (79)
42 TIGR02977 phageshock_pspA phag 49.1 59 0.0013 32.8 7.3 109 153-261 25-137 (219)
43 cd06423 CESA_like CESA_like is 48.2 1.6E+02 0.0036 25.8 9.5 32 318-351 10-41 (180)
44 cd06439 CESA_like_1 CESA_like_ 46.5 2.2E+02 0.0047 28.0 10.9 103 306-434 29-133 (251)
45 PRK10807 paraquat-inducible pr 45.2 77 0.0017 36.6 8.3 44 209-256 473-516 (547)
46 cd06434 GT2_HAS Hyaluronan syn 44.7 2.2E+02 0.0047 27.5 10.4 105 309-444 3-110 (235)
47 PF05704 Caps_synth: Capsular 44.3 37 0.0008 35.7 5.2 99 302-433 42-143 (276)
48 PF04012 PspA_IM30: PspA/IM30 42.1 88 0.0019 31.2 7.3 109 153-261 24-136 (221)
49 cd04190 Chitin_synth_C C-termi 40.6 76 0.0017 31.8 6.7 24 410-433 72-96 (244)
50 cd04192 GT_2_like_e Subfamily 39.8 2.1E+02 0.0046 27.2 9.4 36 313-348 5-40 (229)
51 PRK10404 hypothetical protein; 37.5 1.6E+02 0.0035 26.4 7.5 78 181-260 5-83 (101)
52 PRK11204 N-glycosyltransferase 36.7 3.4E+02 0.0075 29.3 11.4 116 304-445 52-169 (420)
53 PRK10698 phage shock protein P 35.8 1.3E+02 0.0027 30.7 7.3 108 153-260 25-136 (222)
54 PF04765 DUF616: Protein of un 32.8 1E+02 0.0022 33.1 6.3 93 336-445 91-188 (305)
55 cd04196 GT_2_like_d Subfamily 30.5 3.3E+02 0.0071 25.6 9.0 99 311-434 3-103 (214)
56 COG0836 {ManC} Mannose-1-phosp 30.5 28 0.00062 37.5 1.7 24 471-494 186-209 (333)
57 PF05957 DUF883: Bacterial pro 30.4 2E+02 0.0043 24.9 6.7 75 185-261 2-77 (94)
58 PLN02867 Probable galacturonos 29.0 1.7E+02 0.0037 33.8 7.5 76 181-258 89-166 (535)
59 cd04185 GT_2_like_b Subfamily 27.5 4.9E+02 0.011 24.4 9.6 23 411-433 79-102 (202)
60 COG1842 PspA Phage shock prote 27.3 1.7E+02 0.0038 30.0 6.7 106 154-259 26-135 (225)
61 PF03314 DUF273: Protein of un 25.7 42 0.00092 34.2 1.9 24 404-427 34-57 (222)
62 TIGR03469 HonB hopene-associat 24.9 8E+02 0.017 26.5 11.7 112 306-433 40-156 (384)
63 PF11464 Rbsn: Rabenosyn Rab b 23.9 1E+02 0.0022 23.6 3.2 36 165-200 2-37 (42)
64 TIGR03111 glyc2_xrt_Gpos1 puta 22.8 7.3E+02 0.016 27.5 11.1 48 305-352 48-96 (439)
65 cd02510 pp-GalNAc-T pp-GalNAc- 21.8 6.1E+02 0.013 26.0 9.7 101 310-433 2-106 (299)
66 PF06103 DUF948: Bacterial pro 21.7 5.1E+02 0.011 22.1 7.7 61 188-254 22-82 (90)
67 PF10146 zf-C4H2: Zinc finger- 20.8 4.8E+02 0.01 26.9 8.4 88 169-259 16-103 (230)
68 PF10073 DUF2312: Uncharacteri 20.1 3.4E+02 0.0073 23.3 5.9 48 188-245 4-53 (74)
No 1
>PLN02829 Probable galacturonosyltransferase
Probab=100.00 E-value=8.1e-156 Score=1268.39 Aligned_cols=585 Identities=47% Similarity=0.875 Sum_probs=532.7
Q ss_pred hhHHHHHHHHHHHHHHhhcceEEEecccCc-cccccccchhhhhcccccccccccccccccccccccCCCcEEeecCCCc
Q 007588 4 VRRWQRISILALLSVSVIAPVIFVSNRLKV-FTSIGRWDFAEELSTTKFRAENIRLNAIEQEADEGLKEPKLVVYKDEDL 82 (597)
Q Consensus 4 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 82 (597)
+|||+|++||+||||||+|||+|||+||++ |||++++||+|||+++++++|+.+|||||||++++||||+||||+|+++
T Consensus 1 ~~~~~r~~~~~~l~~~v~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~~~~~~~~lk~p~~~~~~~~~~ 80 (639)
T PLN02829 1 MRMRLRNLVLGLLLLTVLSPILLYTDRLSASFTPSSKRDFLEDVTALTLGGDASKLNVLPQESSSSLKEPIGIVYSDNSS 80 (639)
T ss_pred CcHHHHHHHHHHHHHHHhhceeEEecccccccCCcchhhhhHHHHhhccCccchhcccccccccccccCceeEEeecccc
Confidence 589999999999999999999999999998 8999999999999999999999999999999999999999999999987
Q ss_pred cccccc---------------cccCCCccccccccCccccccC---CCCcchhhhhh------------hhhhhhcccCC
Q 007588 83 GSLVSY---------------STSTESDTKQSQYAGDTNILEN---NGTDEGKEENK------------KMKQKTASSGS 132 (597)
Q Consensus 83 ~~~~~~---------------~~~~~~~~~~~~~~~~~~~~~~---~~~~~~~~~~~------------~~~~~~~~~~~ 132 (597)
+..... -.+.++|+++|+.++.|+|+-. +-.+...+.+. +.+|...++..
T Consensus 81 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 160 (639)
T PLN02829 81 KTIEPDSQDLLLDKRGEHKARVLSATDDDTHSQTDDIIKQVTQKAGQDDSDQQEKNSQSQSASQAESLEHVQQSAQTSEK 160 (639)
T ss_pred ccccccccccccccccchhhhhccccccccccccchhHHHhhhcccccccccccccccccccccccchhhhhhhhccccc
Confidence 743222 1344689999999999999831 11111111111 11222211111
Q ss_pred CCcccccc-ccccCCCCcccccccCcHHHHHHhhHHHHHHHHHHhhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCccc
Q 007588 133 RGKDQTNQ-AGARRSPNVQASLLRVSDEKIKEMKDQVIRAQAYLNFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDLS 211 (597)
Q Consensus 133 ~~~~~~~~-~~~~~~~~~~~~~~~~~d~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~ 211 (597)
.+. +.. .+.++.|..+ .+++|++||+|||||||||||++|||+++|++|+|||+++|||+||+||+|+.|+|||
T Consensus 161 ~~~--~~~~~~~~~~~~~~---~~~~d~~v~~lkDql~~AkaY~~iak~~~~~~l~~el~~~i~e~~r~l~~a~~d~~lp 235 (639)
T PLN02829 161 VDE--KEPLLTKTDKQTDQ---TVMPDARVRQLRDQLIKAKVYLSLPATKANPHFTRELRLRIKEVQRVLGDASKDSDLP 235 (639)
T ss_pred ccc--cccccccccccccc---ccCchHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhhccCCCCCC
Confidence 111 111 2222333333 3679999999999999999999999999999999999999999999999999999999
Q ss_pred HHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCc
Q 007588 212 RRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQP 291 (597)
Q Consensus 212 ~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~ 291 (597)
+++.++|++|+++|++||++++||+++++|||||++++||++++||+|++|++||||+|+|||||||+||||.|||.+.+
T Consensus 236 ~~~~~~~~~m~~~i~~ak~~~~d~~~~~~KLr~~l~~~Ee~~~~~~~q~~~l~~laa~t~PK~lHCL~mrLt~Ey~~~~~ 315 (639)
T PLN02829 236 KNANEKLKAMEQTLAKGKQMQDDCSIVVKKLRAMLHSAEEQLRVHKKQTMFLTQLTAKTLPKGLHCLPLRLTTEYYNLNS 315 (639)
T ss_pred hhHHHHHHHHHHHHHHHHhcccCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhCCCCccccchhhHHHHHhCCh
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred CCCCCCCCCCCCCCCceeEEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEcc
Q 007588 292 EERHLPNQQDLHNPDLHHYAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSID 371 (597)
Q Consensus 292 ~~~~~~~~~~l~d~~~ihIv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~ 371 (597)
..+++|+.++++||+.+|||++|||+||++|||+|++.|+++|++++||||||.+|+.+|++||.+|++++++|+|.+++
T Consensus 316 ~~~~~p~~~~l~dp~l~Hy~ifSdNVLAasVVVnStv~na~~p~k~VFHivTD~~ny~aM~~WF~~n~~~~A~v~V~nie 395 (639)
T PLN02829 316 SEQQFPNQEKLEDPQLYHYALFSDNVLAAAVVVNSTVTNAKHPSKHVFHIVTDRLNYAAMRMWFLVNPPGKATIQVQNIE 395 (639)
T ss_pred hhccCCChhhccCCccceEEEEecceeEEEeeeehhhhcccCccceEEEEecCccchHHHHHHHhhCCCccceEEEEehh
Confidence 98888999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred CCcccchhhhhhhhccCC---------------------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHH
Q 007588 372 NFNWLSTKYNATLKKENS---------------------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGR 430 (597)
Q Consensus 372 ~f~~l~~~~~~vlk~l~s---------------------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLse 430 (597)
+|+|++.+|+|+++++++ ++|+|+|+++|+|||||++||+++||||||+||||++||++
T Consensus 396 ~f~wln~~~~pvl~ql~~~~~~~~yf~~~~~~~~~~~k~r~p~ylS~lnY~RfyLPeLLP~LdKVLYLD~DVVVqgDLse 475 (639)
T PLN02829 396 EFTWLNSSYSPVLKQLGSQSMIDYYFRAHRANSDSNLKYRNPKYLSILNHLRFYLPEIFPKLNKVLFLDDDIVVQKDLTG 475 (639)
T ss_pred hcccccccccHHHHHhhhhhhhhhhhhccccCcccccccCCcchhhHHHHHHHHHHHHhcccCeEEEEeCCEEeCCChHH
Confidence 999999999999998874 56899999999999999999999999999999999999999
Q ss_pred hhccCCCCCEEEEecccccchhhhhhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCC
Q 007588 431 LWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKR 510 (597)
Q Consensus 431 Lw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~ 510 (597)
||++||+|+++|||+||.. .++++..+++|++|.+..+|+++.||||+|||||||++||+++++++|+.|++.+.++
T Consensus 476 Lw~iDL~gkviAAVedc~~---~f~r~~~~l~fs~p~i~~~Fn~~~CyFNSGVmVINL~~WRe~nITe~y~~wm~~n~~r 552 (639)
T PLN02829 476 LWSIDLKGNVNGAVETCGE---SFHRFDRYLNFSNPLISKNFDPHACGWAYGMNVFDLDEWKRQNITEVYHSWQKLNHDR 552 (639)
T ss_pred HHhCCCCCceEEEeccchh---hhhhhhhhhhccchHhhhccCCcccceecceEEEeHHHHHHhChHHHHHHHHHHccCC
Confidence 9999999999999999986 6788999999999999999999999999999999999999999999999999998888
Q ss_pred CCCCCCCcchhhhhhccceeEecccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccc
Q 007588 511 PLWKAGSLPLGWVTFYKHTMALDKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFL 590 (597)
Q Consensus 511 ~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl 590 (597)
.+|++|+||+++++|+|++++||++||++|+||++.+..+.+++|+||||+|++|||+..++++|+++|.+|++++++||
T Consensus 553 ~L~dlgaLPp~Ll~F~g~i~~LD~rWNv~GLGy~~~v~~~~i~~aaIIHynG~~KPWle~~i~~yr~lW~kYl~~~~~fl 632 (639)
T PLN02829 553 QLWKLGTLPPGLITFWKRTYPLDRSWHVLGLGYNPNVNQRDIERAAVIHYNGNMKPWLEIGIPKYRNYWSKYVDYDQVYL 632 (639)
T ss_pred ccccccCCChHHHHhcCceEecChhheecCCCCCcccchhcccCCeEEEECCCCCccccCCcccchHHHHHHHhcCchHH
Confidence 89999999999999999999999999999999988777788999999999999999999999999999999999999999
Q ss_pred cccccC
Q 007588 591 QRCNLH 596 (597)
Q Consensus 591 ~~Cn~~ 596 (597)
++||||
T Consensus 633 ~~Cni~ 638 (639)
T PLN02829 633 RECNIN 638 (639)
T ss_pred HhCCCC
Confidence 999997
No 2
>PLN02718 Probable galacturonosyltransferase
Probab=100.00 E-value=2.3e-155 Score=1267.82 Aligned_cols=589 Identities=69% Similarity=1.130 Sum_probs=553.0
Q ss_pred ChhhhHHHHHHHHHHHHHHhhcceEEEecccCccccccccchhhhhcccccccccccccccccccccccCCCcEEeecCC
Q 007588 1 MNQVRRWQRISILALLSVSVIAPVIFVSNRLKVFTSIGRWDFAEELSTTKFRAENIRLNAIEQEADEGLKEPKLVVYKDE 80 (597)
Q Consensus 1 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 80 (597)
|||+|||+|++||+||||||+|||+|||+||++|||++|+||+|||+++++++|+.+|||||||++++||||++|||+|+
T Consensus 1 ~~~~~~~~r~~~~~~l~~~v~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~~~~~~~~lk~~~~~~~~~~ 80 (603)
T PLN02718 1 MKQVRRWQRILILSLLSLSVFAPLIFVSNRLKSITPVGRKEFIEELSTIRYRTDDLRLSAIEQEEGEGLKGPKLVIYQDG 80 (603)
T ss_pred ChHHHHHHHHHHHHHHHHHHhhceeEeeccccccCccchhhhHHHHhhhccccCccccccccccccccccCceeEEeecC
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred Cccccccccc-cCCCccccccccCccccccCCCCcchhhhhhhhhhhhcccCCCC------------ccccccccccCCC
Q 007588 81 DLGSLVSYST-STESDTKQSQYAGDTNILENNGTDEGKEENKKMKQKTASSGSRG------------KDQTNQAGARRSP 147 (597)
Q Consensus 81 ~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~------------~~~~~~~~~~~~~ 147 (597)
++++.+++++ ..++|.-++ +..++..|...+++..++|.+..+.+++ +.+.++++.++++
T Consensus 81 ~~~~~~~~~~~~~~~~~~~~-------~~~~~~~h~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 153 (603)
T PLN02718 81 DFNSVVSYNSSDKNNDSLES-------EVDGGNNHKPKEEQAQVSQKTTVSSSEEVQISARDIQLNHKTQFNPPTVKHEK 153 (603)
T ss_pred CcCccccccccccccchhhh-------hccCccccccchhcccchheeecccccccccchhhhhhhhhhccCCCcccccc
Confidence 9999988754 445666444 3334556776777777777666555544 4455668889999
Q ss_pred CcccccccCcHHHHHHhhHHHHHHHHHHhhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHH
Q 007588 148 NVQASLLRVSDEKIKEMKDQVIRAQAYLNFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDK 227 (597)
Q Consensus 148 ~~~~~~~~~~d~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~ 227 (597)
+.|+++++++|++||+|||||||||||++|||+++|++|+|||+++|||+||+||+|+.|+|||+++.++|++|+++|++
T Consensus 154 ~~~~~~~~~~d~~v~~~~dql~~ak~y~~~a~~~~~~~~~~el~~~i~e~~~~l~~~~~d~~lp~~~~~~~~~m~~~~~~ 233 (603)
T PLN02718 154 NTRVQPRRATDEKVKEIRDKIIQAKAYLNLAPPGSNSQLVKELRLRTKELERAVGDATKDKDLSKSALQRMKSMEVTLYK 233 (603)
T ss_pred cCcCCcccCcHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhcccCCCCCCHhHHHHHHHHHHHHHH
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred hhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCcCCCCCCCCCCCCCCCc
Q 007588 228 ASHVYPDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQPEERHLPNQQDLHNPDL 307 (597)
Q Consensus 228 ~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~~~~~~~~~~l~d~~~ 307 (597)
||+++|||++|++|||||++++||++++||+|++|++||||+|+|||||||+||||+|||.+.+..+++|++++++||+.
T Consensus 234 a~~~~~d~~~~~~klr~~~~~~e~~~~~~~~q~~~~~~laa~~~PK~lhCL~~rLt~ey~~~~~~~~~~~~~~~l~d~~~ 313 (603)
T PLN02718 234 ASRVFPNCPAIATKLRAMTYNTEEQVRAQKNQAAYLMQLAARTTPKGLHCLSMRLTAEYFALDPEKRQLPNQQRYNDPDL 313 (603)
T ss_pred HHhccccHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchhhHHHHhhCChhhccCCChhhccCCcc
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred eeEEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhcc
Q 007588 308 HHYAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKE 387 (597)
Q Consensus 308 ihIv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l 387 (597)
+|||+++||++++||+|+|++.|+++|++++|||+||++++++|+.|+.+++..+++|+|+++++|.|++.+|+++++++
T Consensus 314 ~Hia~~sDNvlaasVvInSil~Ns~np~~ivFHVvTD~is~~~mk~wf~l~~~~~a~I~V~~Iddf~~lp~~~~~~lk~l 393 (603)
T PLN02718 314 YHYVVFSDNVLACSVVVNSTISSSKEPEKIVFHVVTDSLNYPAISMWFLLNPPGKATIQILNIDDMNVLPADYNSLLMKQ 393 (603)
T ss_pred eeEEEEcCCceeEEEEhhhhhhccCCCCcEEEEEEeCCCCHHHHHHHHHhCCCCCcEEEEEecchhccccccchhhhhhc
Confidence 99999999999999999999999988889999999999999999999999988899999999999999998888889888
Q ss_pred CCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCChh
Q 007588 388 NSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPL 467 (597)
Q Consensus 388 ~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~ 467 (597)
++.+++|+|+++|+||+||++||+++||||||+|+||++||++||++||+|+++|||+||......+++++.++||++|.
T Consensus 394 ~s~~~~~~S~~~y~Rl~ipellp~l~KvLYLD~DvVV~~DL~eL~~iDl~~~v~aaVedC~~~~~~~~~~~~~lnfs~p~ 473 (603)
T PLN02718 394 NSHDPRYISALNHARFYLPDIFPGLNKIVLFDHDVVVQRDLSRLWSLDMKGKVVGAVETCLEGEPSFRSMDTFINFSDPW 473 (603)
T ss_pred cccccccccHHHHHHHHHHHHhcccCEEEEEECCEEecCCHHHHhcCCCCCcEEEEeccccccccchhhhhhhhhccchh
Confidence 88888999999999999999999999999999999999999999999999999999999975322356777889999999
Q ss_pred hhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEecccccccccCCCCCC
Q 007588 468 IAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLGYDSGV 547 (597)
Q Consensus 468 i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy~~~i 547 (597)
+.++|++++||||+|||||||++||++++++++++|++++.++.+|++|+||++|++|+|++++||++||++++||+..+
T Consensus 474 i~~~fn~~~CyfNsGVlLIDLk~WReenITe~~~~~l~~n~~~~l~dqdaLpp~LlvF~gri~~LD~rWNv~gLG~~~~i 553 (603)
T PLN02718 474 VAKKFDPKACTWAFGMNLFDLEEWRRQKLTSVYHKYLQLGVKRPLWKAGSLPIGWLTFYNQTVALDKRWHVLGLGHESGV 553 (603)
T ss_pred hhcccCCCccccccceEEEeHHHHHhcChHHHHHHHHHhccCccccCcccccHHHHHhcCceeecChHHhccCccccccc
Confidence 98899999999999999999999999999999999999988888999999999999999999999999999999998877
Q ss_pred cccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 548 ARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 548 ~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
....+++|+||||+|++|||++.+++.|+++|.+|+++++||+++|||+
T Consensus 554 ~~~~i~~aaIIHYnG~~KPWle~~i~~yr~~W~k~v~~~~~~l~~Cn~~ 602 (603)
T PLN02718 554 GASDIEQAAVIHYDGVMKPWLDIGIGKYKRYWNIHVPYHHPYLQQCNIH 602 (603)
T ss_pred cccccCCCEEEEECCCCCccccCChhhHHHHHHhhcCCCChHHHhcCCC
Confidence 7778899999999999999999999999999999999999999999997
No 3
>PLN02910 polygalacturonate 4-alpha-galacturonosyltransferase
Probab=100.00 E-value=5.3e-125 Score=1025.01 Aligned_cols=440 Identities=52% Similarity=0.952 Sum_probs=428.9
Q ss_pred ccCcHHHHHHhhHHHHHHHHHHhhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccC
Q 007588 154 LRVSDEKIKEMKDQVIRAQAYLNFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYP 233 (597)
Q Consensus 154 ~~~~d~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~ 233 (597)
.+++|++||+|||||||||||++|||++||++|++||+++|||+||+||+|++|+|||+++.++|++||++|++||++++
T Consensus 192 ~~~~d~~vk~lkDQl~~AkaY~~iak~~~~~~l~~eL~~~i~e~~r~ls~a~~d~dlp~~~~~k~~~M~~~l~~ak~~~~ 271 (657)
T PLN02910 192 SPNSDSILKLMRDQIIMAKAYANIAKSNNVTNLYVSLMKQFRENKRAIGEATSDAELHSSALDQAKAMGHVLSIAKDQLY 271 (657)
T ss_pred ccCcHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhhcccccccCchHHHHHHHHHHHHHHHHhccc
Confidence 47899999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred ChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCcCCCCCCCCCCCCCCCceeEEEE
Q 007588 234 DCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQPEERHLPNQQDLHNPDLHHYAVF 313 (597)
Q Consensus 234 ~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~~~~~~~~~~l~d~~~ihIv~~ 313 (597)
||++|++||||||+++||++++||+|++|++||||+|+|||||||+||||.|||.+.+..+++|+.++++||+.+|+|++
T Consensus 272 d~~~~~~KLraml~~~Ee~~~~~k~qs~~l~qlaa~t~PK~lHCL~mRLt~Ey~~~~~~~~~~p~~~~l~dp~l~Hy~if 351 (657)
T PLN02910 272 DCHTMARKLRAMLQSTERKVDALKKKSAFLIQLAAKTVPKPLHCLPLQLAADYFLLGFQNKDYVNKKKLEDPSLYHYAIF 351 (657)
T ss_pred CHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchhhHHHHHhCchhhccCCChhhccCCcceeEEEE
Confidence 99999999999999999999999999999999999999999999999999999999999888999999999999999999
Q ss_pred eCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC----
Q 007588 314 SDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS---- 389 (597)
Q Consensus 314 sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s---- 389 (597)
|||+||++|||+|++.|+++|++++||||||.+|+.+|++||.+|++++++|+|.++++|+|++.+|+|+++++++
T Consensus 352 SDNVLAaSVVVnSTv~na~~P~k~VFHiVTD~~ny~aM~~WF~~n~~~~A~V~V~nie~f~wln~~~~pvl~qles~~~~ 431 (657)
T PLN02910 352 SDNVLATSVVVNSTVLHAKEPQKHVFHIVTDKLNFAAMKMWFIINPPAKATIQVENIDDFKWLNSSYCSVLRQLESARIK 431 (657)
T ss_pred ecceeeEEeehhhhhhcccCccceEEEEecCccccHHHHHHHhhCCCccceEEEeehhhcccccccccHHHHHHhhhhhh
Confidence 9999999999999999999999999999999999999999999999999999999999999999999999988654
Q ss_pred ---------------------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccc
Q 007588 390 ---------------------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCK 448 (597)
Q Consensus 390 ---------------------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~ 448 (597)
++|+|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++|||+||.
T Consensus 432 ~~yf~~~~~~~~~~~~~~~k~r~p~ylS~lnY~Rf~LPelLp~l~KVLYLD~DVVV~gDLseLw~iDL~g~v~AAVedc~ 511 (657)
T PLN02910 432 EYYFKANHPSSLSAGADNLKYRNPKYLSMLNHLRFYLPEVYPKLEKILFLDDDIVVQKDLTPLWSIDMQGMVNGAVETCK 511 (657)
T ss_pred hhhhhccccccccccccccccCCcchhhHHHHHHHHHHHHhhhcCeEEEEeCCEEecCchHHHHhCCcCCceEEEecccc
Confidence 45899999999999999999999999999999999999999999999999999999998
Q ss_pred cchhhhhhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc
Q 007588 449 ESEASFRRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH 528 (597)
Q Consensus 449 ~~~~~~~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~ 528 (597)
. .|+++..+++|++|.++++|+++.||||+|||||||++||++++|+.+..|++.+.+..+|++|+|||++++|+|+
T Consensus 512 ~---~f~r~~~ylnfs~P~i~~yFNs~aCyfNsGVmVIDL~~WRe~nITe~ye~w~eln~~~~L~dqgsLPpgLLvF~g~ 588 (657)
T PLN02910 512 E---SFHRFDKYLNFSNPKISENFDPNACGWAFGMNMFDLKEWRKRNITGIYHYWQDLNEDRTLWKLGSLPPGLITFYNL 588 (657)
T ss_pred h---hhhhhhhhhccCChhhhhccCCCCceeecccEEEeHHHHHHhhHHHHHHHHHHhcccccccccCCCChHHHHHhCc
Confidence 7 6788999999999999999999999999999999999999999999999999999889999999999999999999
Q ss_pred eeEecccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 529 TMALDKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 529 i~~Ld~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
+++||++||++|+||++.+..+.+++|+||||+|++|||+..++++|+++|.+|+++++|||++|||+
T Consensus 589 i~pLD~rWNv~GLGyd~~v~~~~i~~AAVLHynG~~KPWl~l~i~~Yr~~W~kYl~~d~~fl~~Cni~ 656 (657)
T PLN02910 589 TYPLDRSWHVLGLGYDPALNQTEIENAAVVHYNGNYKPWLDLAIAKYKPYWSRYVQYDNPYLQLCNIS 656 (657)
T ss_pred eeecCchheecCCCCCcccccccccCcEEEEeCCCCCcccccCcccchHHHHHHccCCChHHHhCCCC
Confidence 99999999999999998887788999999999999999999999999999999999999999999997
No 4
>PLN02769 Probable galacturonosyltransferase
Probab=100.00 E-value=4.1e-122 Score=1009.98 Aligned_cols=433 Identities=39% Similarity=0.681 Sum_probs=409.0
Q ss_pred ccCcHHHHHHhhHHHHHHHHHH-hhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhccc
Q 007588 154 LRVSDEKIKEMKDQVIRAQAYL-NFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVY 232 (597)
Q Consensus 154 ~~~~d~~~~~~~dq~~~a~~y~-~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~ 232 (597)
.+++|++||+|||||||||||+ +|||+++|++|+|||+++|||+||+|||++.|+|||+++.++|++|+++|++||++.
T Consensus 176 ~~~~d~~~~~l~Dql~~Ak~y~~~iak~~~~~~l~~el~~~i~e~~~~l~~~~~d~dlp~~~~~~~~~m~~~~~~ak~~~ 255 (629)
T PLN02769 176 EVMKDSIVKRLKDQLFVARAYYPSIAKLPGQEKLTRELKQNIQEHERVLSESITDADLPPFIQKKLEKMEQTIARAKSCP 255 (629)
T ss_pred ccCcHHHHHHHHHHHHHHHHHHHhhcccCCcHHHHHHHHHHHHHHHHHHhhccccccCChhHHHHHHHHHHHHHHHHhhc
Confidence 4789999999999999999997 999999999999999999999999999999999999999999999999999999999
Q ss_pred CChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCcCCCCCCCCCCCCCCCceeEEE
Q 007588 233 PDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQPEERHLPNQQDLHNPDLHHYAV 312 (597)
Q Consensus 233 ~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~~~~~~~~~~l~d~~~ihIv~ 312 (597)
|||++|++||||||++|||++++|++|++|++||||+|+|||||||+||||.|||.+.+..+++|+.++++||+.+|||+
T Consensus 256 ~dc~~~~~klr~~l~~~E~~~~~~~kq~~~l~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~l~d~~l~Hy~i 335 (629)
T PLN02769 256 VDCNNVDRKLRQILDMTEDEAHFHMKQSAFLYQLGVQTMPKSHHCLSMRLTVEYFKSSSLDMEDSNSEKFSDPSLRHYVI 335 (629)
T ss_pred cchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhcCCCccccchhhHHHHHhCchhhccCCchhhccCCccceEEE
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred EeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC---
Q 007588 313 FSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS--- 389 (597)
Q Consensus 313 ~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s--- 389 (597)
+|||++|++|+|+|++.|+++|++++||||||..++.+|++||..+++++++|+++++++|+|.+. .+++++++++
T Consensus 336 fSdNvlAasvvvNStv~na~~p~~~VFHiVTD~~n~~am~~WF~~n~~~~a~v~v~n~e~~~~~~~-~~~~~~~l~~~~~ 414 (629)
T PLN02769 336 FSKNVLAASVVINSTVVHSRESGNIVFHVLTDAQNYYAMKHWFDRNSYKEAAVQVLNIEDLILKDL-DKFALKQLSLPEE 414 (629)
T ss_pred EeccceeeeeehhhhhhhccCccceEEEEecChhhHHHHHHHHhcCCCccceEEEeeeeeeeeccc-chHHHHhhccchh
Confidence 999999999999999999999999999999999999999999999999999999999999999653 3456666532
Q ss_pred ---------------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhh
Q 007588 390 ---------------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASF 454 (597)
Q Consensus 390 ---------------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~ 454 (597)
++++|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++|||+||.. .+
T Consensus 415 ~~~~~~~~~~~~~~~~~~eyiS~~nh~RfyIPELLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkviAAVedc~~---rl 491 (629)
T PLN02769 415 FRVSFRSVDNPSSKQMRTEYLSVFSHSHFLLPEIFKKLKKVVVLDDDVVVQRDLSFLWNLDMGGKVNGAVQFCGV---RL 491 (629)
T ss_pred hhhhhccCCCCchhccCcccccHHHHHHHHHHHHhhhcCeEEEEeCCEEecCcHHHHhcCCCCCCeEEEehhhhh---hh
Confidence 478999999999999999999999999999999999999999999999999999999975 45
Q ss_pred hhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcC--CCCCCCCCCcchhhhhhccceeEe
Q 007588 455 RRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGY--KRPLWKAGSLPLGWVTFYKHTMAL 532 (597)
Q Consensus 455 ~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~--~~~l~d~~~LpilNi~F~g~i~~L 532 (597)
++++.|++ ..+|+++.||||+|||||||++||++++++++++|++++. +...|++++||++|++|+|++++|
T Consensus 492 ~~~~~yl~------~~~F~~~~CyFNSGVLLINL~~WRk~nITe~~~~~~~~~~~~~~~~~~~~~Lp~lnlvF~g~v~~L 565 (629)
T PLN02769 492 GQLKNYLG------DTNFDTNSCAWMSGLNVIDLDKWRELDVTETYLKLLQKFSKDGEESLRAAALPASLLTFQDLIYPL 565 (629)
T ss_pred hhhhhhhc------ccCCCccccccccCeeEeeHHHHHHhCHHHHHHHHHHHhhhcccccccccCcCHHHHHhcCeEEEC
Confidence 55555554 3468889999999999999999999999999999998853 457899999999999999999999
Q ss_pred cccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 533 DKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 533 d~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
|++||++++||++.+..+.+++|+||||+|++|||+..++++|+++||+|++++++||++|||+
T Consensus 566 D~rWNv~gLG~~~~i~~~~i~~paIIHYnG~~KPW~e~~i~~yr~~W~kYl~~~~~fl~~Cni~ 629 (629)
T PLN02769 566 DDRWVLSGLGHDYGIDEQAIKKAAVLHYNGNMKPWLELGIPKYKKYWKRFLNRDDRFMDECNVN 629 (629)
T ss_pred CHHHccccccccccccccccCCcEEEEECCCCCCccCCCCChHHHHHHHHhccCChHHhhCCCC
Confidence 9999999999988777788899999999999999999999999999999999999999999996
No 5
>PLN02742 Probable galacturonosyltransferase
Probab=100.00 E-value=2.1e-122 Score=997.59 Aligned_cols=439 Identities=43% Similarity=0.781 Sum_probs=424.7
Q ss_pred cCcHHHHHHhhHHHHHHHHHHhhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCcc--cHHHHHHHHHHHHHHHHhhccc
Q 007588 155 RVSDEKIKEMKDQVIRAQAYLNFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDL--SRRAFRRMNQMEATLDKASHVY 232 (597)
Q Consensus 155 ~~~d~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~--~~~~~~~~~~m~~~~~~~~~~~ 232 (597)
.++|++||+|||||||||||++|||++||++|++||+++|||+||+||+|+.|+++ |+++.++|+.|+++|++||+++
T Consensus 70 ~~~~~~~~~l~dql~~Ak~y~~ia~~~~~~~l~~el~~~i~e~~~~l~~a~~d~~~~~~~~~~~~~~~m~~~i~~ak~~~ 149 (534)
T PLN02742 70 LSATSFSRQLADQITLAKAYVVIAKEHNNLQLAWELSAQIRNCQLLLSKAATRGEPITVEEAEPIIRDLAALIYQAQDLH 149 (534)
T ss_pred cChHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHHHhhcccccCCchhHHHHHHHHHHHHHHHHhcc
Confidence 56899999999999999999999999999999999999999999999999999887 3799999999999999999999
Q ss_pred CChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCcC---CCCCCCCCCCCCCCcee
Q 007588 233 PDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQPE---ERHLPNQQDLHNPDLHH 309 (597)
Q Consensus 233 ~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~---~~~~~~~~~l~d~~~ih 309 (597)
+||+++++|||||++++||++++||+|++|++||||+|+|||||||+||||+|||.+++. .++++++++++||+.+|
T Consensus 150 ~d~~~~~~klr~~l~~~e~~~~~~~~q~~~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~l~H 229 (534)
T PLN02742 150 YDSATTIMTLKAHIQALEERANAATVQSTKFGQLAAEALPKSLYCLGVRLTTEWFKNPKLQRKAEEKRNSPRLVDNNLYH 229 (534)
T ss_pred ccHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchHhHHHHHhCchhhhccccccccccccCCCcce
Confidence 999999999999999999999999999999999999999999999999999999999877 57788999999999999
Q ss_pred EEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC
Q 007588 310 YAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS 389 (597)
Q Consensus 310 Iv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s 389 (597)
+|++|||++|++|+|+|++.|+++|++++||||||..++.+|++||..+++++++|+|+++++|.|++.+|+|+++++++
T Consensus 230 y~ifSdNvlAasvvvnStv~nsk~P~~~VFHiVTD~~n~~aM~~WF~~n~~~~a~v~V~n~e~f~wl~~~~~pvl~ql~~ 309 (534)
T PLN02742 230 FCVFSDNILATSVVVNSTVSNAKHPDQLVFHLVTDEVNYGAMQAWFAMNDFKGVTVEVQKIEEFSWLNASYVPVLKQLQD 309 (534)
T ss_pred EEEEeccchhhhhhhhhhHhhhcCCCcEEEEEeechhhHHHHHHHHhhCCCCccEEEEEEeccccccccccchHHHHhhh
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999998765
Q ss_pred ---------------------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccc
Q 007588 390 ---------------------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCK 448 (597)
Q Consensus 390 ---------------------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~ 448 (597)
++++|+|+++|+|||||++||+++||||||+|+||++||++||++||+|+++|||+||+
T Consensus 310 ~~~~~~yf~~~~~~~~~~~k~r~p~y~s~~~y~R~~lP~llp~l~KvlYLD~DvVV~~DL~eL~~~DL~~~viaAVedC~ 389 (534)
T PLN02742 310 SDTQSYYFSGSQDDGKTEIKFRNPKYLSMLNHLRFYIPEIYPALEKVVFLDDDVVVQKDLTPLFSIDLHGNVNGAVETCL 389 (534)
T ss_pred hhhhhhhcccccccccccccccCcccccHHHHHHHHHHHHhhccCeEEEEeCCEEecCChHHHhcCCCCCCEEEEeCchh
Confidence 34899999999999999999999999999999999999999999999999999999998
Q ss_pred cchhhhhhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc
Q 007588 449 ESEASFRRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH 528 (597)
Q Consensus 449 ~~~~~~~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~ 528 (597)
. .+++|.+|+||++|.++.+|+++.||||+|||||||++||++++++.++.|++.+.+..+|++|+||+++++|+|+
T Consensus 390 ~---~f~ry~~yLnfS~p~i~~~f~~~aC~fNsGV~ViDL~~WRe~nITe~~~~w~e~n~~~~l~d~gaLpp~LLaF~g~ 466 (534)
T PLN02742 390 E---TFHRYHKYLNFSHPLISSHFDPDACGWAFGMNVFDLVAWRKANVTAIYHYWQEQNVDRTLWKLGTLPPGLLTFYGL 466 (534)
T ss_pred h---hhhhhhhhhcccchhhhccCCCCccccccCcEEEeHHHHHhhcHHHHHHHHHHhccccccccccccchHHHHHcCc
Confidence 7 7889999999999999999999999999999999999999999999999999998888999999999999999999
Q ss_pred eeEecccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 529 TMALDKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 529 i~~Ld~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
+++||++||+.|+||++.++.+.+++|+||||+|++|||.+.++++|+++|++|+++++||+++||||
T Consensus 467 ~~~LD~rWNv~gLG~~~~v~~~~i~~aaILHynG~~KPWl~~~i~~yr~~W~kYl~~s~~fl~~Cni~ 534 (534)
T PLN02742 467 TEPLDRRWHVLGLGYDTNIDPRLIESAAVLHFNGNMKPWLKLAIERYKPLWERYVNYSHPYLQQCNFH 534 (534)
T ss_pred ceecChhheecccccccccchhhccCCeEEEECCCCCcccccCCcccchHHHHHHccCCHHHHhCCCC
Confidence 99999999999999988777788999999999999999999999999999999999999999999996
No 6
>PLN02523 galacturonosyltransferase
Probab=100.00 E-value=3.5e-106 Score=872.14 Aligned_cols=437 Identities=41% Similarity=0.778 Sum_probs=402.9
Q ss_pred cHHHHHHhhHHHHHHHHHHhhCCCC--CCchHHH---HHHHHHHHHHH-----hhcccC---CC----CcccHHHHHHHH
Q 007588 157 SDEKIKEMKDQVIRAQAYLNFAPPG--SNSHLVK---ELKLRIKEVER-----AVGAAT---KD----SDLSRRAFRRMN 219 (597)
Q Consensus 157 ~d~~~~~~~dq~~~a~~y~~~a~~~--~~~~~~~---el~~~~~e~~~-----~~~~~~---~~----~~~~~~~~~~~~ 219 (597)
-|.+.|+..|+..++.||++.|+.. .+++++| ||.+++.++.. .+.+.. .+ .+||+++.+++|
T Consensus 80 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~k 159 (559)
T PLN02523 80 LDQIRKQADDHRTLVNAYAAYARKLKLDNSKLLRLFADLSRNFTDLISKPSYRALLSSDGSAIDEDVLRQFEKEVKERVK 159 (559)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHhhhhHHHHHHHHHHHHhHHHHhhcCccccccccccCCcCchHHHhhcchhHHHHHH
Confidence 4899999999999999999999875 5555555 88999887632 222111 11 458999999999
Q ss_pred HHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccCCcccchhhhHhchHhhhcCcC--CCCCC
Q 007588 220 QMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTTPKGLHCLSMQLTAEYFALQPE--ERHLP 297 (597)
Q Consensus 220 ~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~--~~~~~ 297 (597)
.|+++|.+||+ .+||+.+++|||+|++++||+++++|+|++|++||||+|+|||||||+||||+|||.+.+. ..+++
T Consensus 160 ~~~~~~~~a~~-~~d~~~~~~kl~~~~~~~e~~~~~~~~q~~~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~ 238 (559)
T PLN02523 160 VARQMIAESKE-SFDNQLKIQKLKDTIFAVNEQLTKAKKNGAFASLIAAKSIPKSLHCLAMRLMEERIAHPEKYKDEGKP 238 (559)
T ss_pred HHHHHHHHHHh-hcchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhCCCCccchhhHhHHHHHhChHhhhccCCC
Confidence 99999999997 9999999999999999999999999999999999999999999999999999999998765 34567
Q ss_pred CCCCCCCCCceeEEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccc
Q 007588 298 NQQDLHNPDLHHYAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLS 377 (597)
Q Consensus 298 ~~~~l~d~~~ihIv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~ 377 (597)
+.++++||+.+|||+++||++|++|+|+|++.|+++|++++||||||++|+.+|++||.++++.+++|+|++|++|+|++
T Consensus 239 ~~~~l~dp~l~Hy~ifSdNvlAAsVvInStv~Ns~~p~~~VFHIVTD~ln~~amk~Wf~~n~~~~a~I~V~~Iedf~~ln 318 (559)
T PLN02523 239 PPPELEDPSLYHYAIFSDNVIAASVVVNSAVKNAKEPWKHVFHVVTDRMNLAAMKVMFKMRDLNGAHVEVKAVEDYKFLN 318 (559)
T ss_pred cchhccCCCcceEEEecCcchhhhhhHHHHHHccCCCcceEEEEEeCCCCHHHHHHHHhhCCCCCcEEEEEEeehhhhcc
Confidence 88999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred hhhhhhhhccCC------------------------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhc
Q 007588 378 TKYNATLKKENS------------------------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWN 433 (597)
Q Consensus 378 ~~~~~vlk~l~s------------------------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~ 433 (597)
+.|+|+++++++ ++++|+|+++|+|||||++||+++||||||+||||++||++||+
T Consensus 319 ~~~~pvlk~l~s~~~~~~~f~~~~~~~~~~~~~~k~~~p~ylS~~ny~Rf~IPeLLP~ldKVLYLD~DVVVq~DLseLw~ 398 (559)
T PLN02523 319 SSYVPVLRQLESANLQKFYFENKLENATKDSSNMKFRNPKYLSMLNHLRFYLPEMYPKLHRILFLDDDVVVQKDLTGLWK 398 (559)
T ss_pred cccchHHHhhhhhhhhhhhccccccccccccccccccCcchhhHHHHHHHHHHHHhcccCeEEEEeCCEEecCCHHHHHh
Confidence 999988775554 34689999999999999999999999999999999999999999
Q ss_pred cCCCCCEEEEecccccchhhhhhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCC
Q 007588 434 IDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLW 513 (597)
Q Consensus 434 iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~ 513 (597)
+||+|+++|||+||.. .++++..+++|++|.++++|++++||||+|||||||++||++++|++++.|.+.+.+..+|
T Consensus 399 iDL~gkv~aAVeDc~~---~~~r~~~~ln~s~p~i~~yFNs~aC~wnsGVmlINL~~WRe~nITek~~~w~~ln~~~~l~ 475 (559)
T PLN02523 399 IDMDGKVNGAVETCFG---SFHRYAQYLNFSHPLIKEKFNPKACAWAYGMNIFDLDAWRREKCTEQYHYWQNLNENRTLW 475 (559)
T ss_pred CcCCCceEEEehhhhh---HHHHHHHhhcccchhhhhCcCCCcccccCCcEEEeHHHHHHhchHHHHHHHHHhccccccc
Confidence 9999999999999975 5678888999999999999999999999999999999999999999999888888788899
Q ss_pred CCCCcchhhhhhccceeEecccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCcccccc
Q 007588 514 KAGSLPLGWVTFYKHTMALDKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRC 593 (597)
Q Consensus 514 d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~C 593 (597)
++|+||++|++|+|+|++||++||++++||++.+..+.+++|+||||+|++|||+..++++|+++|++|++++++|+++|
T Consensus 476 DqdaLpp~LivF~gri~~LD~rWNvlglGy~~~i~~~~i~~paIIHYnG~~KPWle~~i~~yr~~W~kYl~~~~~fl~~C 555 (559)
T PLN02523 476 KLGTLPPGLITFYSTTKPLDKSWHVLGLGYNPSISMDEIRNAAVIHFNGNMKPWLDIAMNQFKPLWTKYVDYDMEFVQAC 555 (559)
T ss_pred cccccchHHHHhcCceEecCchhhccCCccCCCccccccCCCEEEEECCCCCccccCCCCcchHHHHHHHccCCHHHHhC
Confidence 99999999999999999999999999999988777788899999999999999999999999999999999999999999
Q ss_pred ccCC
Q 007588 594 NLHV 597 (597)
Q Consensus 594 n~~~ 597 (597)
||+.
T Consensus 556 n~~~ 559 (559)
T PLN02523 556 NFGL 559 (559)
T ss_pred CCCC
Confidence 9973
No 7
>PLN02870 Probable galacturonosyltransferase
Probab=100.00 E-value=1.4e-105 Score=865.15 Aligned_cols=406 Identities=39% Similarity=0.757 Sum_probs=377.9
Q ss_pred CCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhH
Q 007588 182 SNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQAT 261 (597)
Q Consensus 182 ~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~ 261 (597)
+..++.+||.+-+.|. .-+|++.|++||+++.++++ +||+.++||+++++|||||++++||+++++|+|++
T Consensus 87 ~~~~~~~~~~~~l~~~--~~~~~~~d~~lp~s~~~~~~-------~~~~~~~d~~~~~~kl~~~~~~~e~~~~~~~~~~~ 157 (533)
T PLN02870 87 DSERLVRDFYKILNEV--NTEEIPDGLKLPDSFSQLVS-------DMKNNHYDAKTFAFVLRAMMEKFERELRESKFAEL 157 (533)
T ss_pred chhhhHHHHHHHHHHh--ccccccccccCChhHHHHHH-------HHHhccccHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 3447899999988875 44799999999999987774 77889999999999999999999999999999999
Q ss_pred HHHHHhhccCCcccchhhhHhchHhhhcCcCCCCCCC---CCCCCCCCceeEEEEeCcchhHHHHHHHHHhhcCCCCcEE
Q 007588 262 YLVQLASRTTPKGLHCLSMQLTAEYFALQPEERHLPN---QQDLHNPDLHHYAVFSDNVLACAVVVNSTVSFAKEPEKIV 338 (597)
Q Consensus 262 ~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~~~~~~~---~~~l~d~~~ihIv~~sDn~laasVvI~Slv~Na~~p~~i~ 338 (597)
|++||||+|+|||||||+||||+|||.+.+..++.|. .++|+||+.+|+|++|||+||++|||+|++.|+++|++++
T Consensus 158 ~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~e~~~~l~dp~~~Hy~ifSdNvLAasVvvnStv~~a~~p~~~V 237 (533)
T PLN02870 158 MNKHFAASSIPKGIHCLSLRLTDEYSSNAHARKQLPSPELLPVLSDNSYHHFVLSTDNILAASVVVSSTVQSSLKPEKIV 237 (533)
T ss_pred HHHHHHHhhcCCCccccchhhHHHHHhCchhhhcCCcccccccccCCcceeEEEEecceeEEEeeeehhhhcccCccceE
Confidence 9999999999999999999999999998877666554 4599999999999999999999999999999999999999
Q ss_pred EEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC-----------------------------
Q 007588 339 FHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS----------------------------- 389 (597)
Q Consensus 339 FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s----------------------------- 389 (597)
||||||.+|+.+|++||.+|++++++|||.++++|+|++.+|+|+++++++
T Consensus 238 FHvvTD~~n~~aM~~WF~~n~~~~a~v~V~~~e~f~wl~~~~~pvl~~~e~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 317 (533)
T PLN02870 238 FHVITDKKTYAGMHSWFALNSVSPAIVEVKGVHQFDWLTRENVPVLEAVESHNGIRNYYHGNHIAGANLSETTPRTFASK 317 (533)
T ss_pred EEEecCccccHHHHHHHhhCCCccceEEEEehhhccccccccchHHHHHhhhHHHHHHhhcccccccccccccchhhhcc
Confidence 999999999999999999999999999999999999999999999987762
Q ss_pred ---CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccch--hhhhhhhcccCCC
Q 007588 390 ---HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESE--ASFRRMDLFINFS 464 (597)
Q Consensus 390 ---~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~--~~~~r~~~~Lnfs 464 (597)
++|+|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++|||+||.... +.+++++.|+||+
T Consensus 318 l~~~~p~ylS~lny~Rl~LPelLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkviaAVeDc~~~~~~~~~~~~~~YfNfs 397 (533)
T PLN02870 318 LQARSPKYISLLNHLRIYLPELFPNLDKVVFLDDDVVIQRDLSPLWDIDLGGKVNGAVETCRGEDEWVMSKRFRNYFNFS 397 (533)
T ss_pred cccCCccccCHHHHHHHHHHHHhhhcCeEEEEeCCEEecCcHHHHhhCCCCCceEEEEccccccchhhhhhhhhhhcccc
Confidence 36899999999999999999999999999999999999999999999999999999996532 1346788899999
Q ss_pred ChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcC--CCCCCCCCCcchhhhhhccceeEecccccccccC
Q 007588 465 DPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGY--KRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLG 542 (597)
Q Consensus 465 ~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~--~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lg 542 (597)
+|.+..+|++++||||||||||||++||++++++++++|++++. +..+|+||+||++|++|+|++++||++||++++|
T Consensus 398 ~p~i~~~fd~~~cyfNSGVlLINL~~WRe~nITek~~~~l~~n~~~~l~l~DQdaLp~~livf~g~v~~LD~rWN~~gLg 477 (533)
T PLN02870 398 HPLIAKNLDPEECAWAYGMNIFDLRAWRKTNIRETYHSWLKENLKSNLTMWKLGTLPPALIAFKGHVHPIDPSWHMLGLG 477 (533)
T ss_pred cchhhcccCcccceeeccchhccHHHHHHcChHHHHHHHHHhhhhcCceecccccccHhHHHhcCceEECChHHhcCCCC
Confidence 99999999999999999999999999999999999999998864 4578999999999999999999999999999999
Q ss_pred CCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 543 YDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 543 y~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
|+.....+.+++|+||||+|++|||++.++++|+.+|.+|++++++|+++|||+
T Consensus 478 y~~~~~~~~i~~aaIIHY~G~~KPW~~~~~~~yr~~W~kYl~~s~~fl~~Cni~ 531 (533)
T PLN02870 478 YQSKTNIESVKKAAVIHYNGQSKPWLEIGFEHLRPFWTKYVNYSNDFIRNCHIL 531 (533)
T ss_pred CcccccccccCCcEEEEECCCCCCccccCccchhHHHHHHHccCchHhhhcCCC
Confidence 987666677899999999999999999999999999999999999999999996
No 8
>PLN02659 Probable galacturonosyltransferase
Probab=100.00 E-value=3.5e-104 Score=854.48 Aligned_cols=406 Identities=36% Similarity=0.721 Sum_probs=374.5
Q ss_pred CCchHHHHHHHHHHH-HHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhh
Q 007588 182 SNSHLVKELKLRIKE-VERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQA 260 (597)
Q Consensus 182 ~~~~~~~el~~~~~e-~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~ 260 (597)
...++++||.+.+.| ... .|...|.++|+++.+++ .++++.++||++|++|||||++++||+++++|+|+
T Consensus 87 ~~~~~~~~~~~~~~~~~~~--~e~~~~~~~~~~~~~~~-------~~~~~~~~d~~~~~~klr~~l~~~E~~~~~~k~~~ 157 (534)
T PLN02659 87 DSANVPEVMYQVLEQPLSN--DELKGRSDIPQTLEEFM-------DEVKNSRSDARAFALKLREMVTLLEQRTRTAKIQE 157 (534)
T ss_pred cccccHHHHHHHHHhhhcc--cccCCccccchHHHHHH-------HHHHhccccHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 445788899988877 433 47788899999997777 55566899999999999999999999999999999
Q ss_pred HHHHHHhhccCCcccchhhhHhchHhhhcCcCCCCCCCC---CCCCCCCceeEEEEeCcchhHHHHHHHHHhhcCCCCcE
Q 007588 261 TYLVQLASRTTPKGLHCLSMQLTAEYFALQPEERHLPNQ---QDLHNPDLHHYAVFSDNVLACAVVVNSTVSFAKEPEKI 337 (597)
Q Consensus 261 ~~~~~la~~~~Pk~~hcl~~rlt~e~~~~~~~~~~~~~~---~~l~d~~~ihIv~~sDn~laasVvI~Slv~Na~~p~~i 337 (597)
.++.||||+|+|||||||+||||+|||.+.+..++.|+. ++++||+.+|+|++|||+||++|||+|++.|+++|+++
T Consensus 158 ~~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~l~Hy~ifSdNvLAasVVvnStv~~a~~p~~~ 237 (534)
T PLN02659 158 YLYRHVASSSIPKQLHCLALRLANEHSTNAAARLQLPLAELVPALVDNSYFHFVLASDNILAASVVANSLVQNALRPHKF 237 (534)
T ss_pred HHHHHHHhhhCCCCccccchhhHHHHHhCchhhhccCCcccccccCCCCcceEEEEecceeEEEeeeehhhhcccCccce
Confidence 999999999999999999999999999999877665544 48999999999999999999999999999999999999
Q ss_pred EEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC----------------------------
Q 007588 338 VFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS---------------------------- 389 (597)
Q Consensus 338 ~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s---------------------------- 389 (597)
+||||||.+|+.+|++||.+|++++++|||.++++|+|++.+|+|+++++++
T Consensus 238 VFHivTD~~ny~aM~~WF~~n~~~~a~v~V~~~e~f~wl~~~~~pvl~ql~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 317 (534)
T PLN02659 238 VLHIITDRKTYSPMQAWFSLHPLSPAIIEVKALHHFDWFAKGKVPVLEAMEKDQRVRSQFRGGSSAIVANNTEKPHVIAA 317 (534)
T ss_pred EEEEecCccccHHHHHHHhhCCCccceEEEEeehhcccccccccHHHHHHhhhhhhhhhhcccccccccccccCcccccc
Confidence 9999999999999999999999999999999999999999999999998762
Q ss_pred ----CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccch--hhhhhhhcccCC
Q 007588 390 ----HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESE--ASFRRMDLFINF 463 (597)
Q Consensus 390 ----~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~--~~~~r~~~~Lnf 463 (597)
++|+|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++|||+||...+ ...++++.+++|
T Consensus 318 ~l~~~~p~ylS~~nY~RL~IPeLLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkv~AAVeDc~~~d~~~~~~~~~~yL~~ 397 (534)
T PLN02659 318 KLQALSPKYNSVMNHIRIHLPELFPSLNKVVFLDDDIVVQTDLSPLWDIDMNGKVNGAVETCRGEDKFVMSKKLKSYLNF 397 (534)
T ss_pred ccccCCccceeHHHHHHHHHHHHhhhcCeEEEeeCCEEEcCchHHHHhCCCCCcEEEEeeccccccchhhhHHHHHhhcc
Confidence 57899999999999999999999999999999999999999999999999999999996421 123677888999
Q ss_pred CChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHc--CCCCCCCCCCcchhhhhhccceeEeccccccccc
Q 007588 464 SDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLG--YKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGL 541 (597)
Q Consensus 464 s~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~--~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~l 541 (597)
++|.+.++|+++.||||+|||||||++||++++++++++|++++ .+..+|+||+||++|++|+|++++||++||++++
T Consensus 398 s~p~i~~yFn~~~cYfNsGVlLINLk~WRe~nITek~l~~l~~n~~~~l~l~DQdaLp~~LivF~g~v~~LD~rWN~~gL 477 (534)
T PLN02659 398 SHPLIAKNFDPNECAWAYGMNIFDLEAWRKTNISSTYHHWLEENLKSDLSLWQLGTLPPGLIAFHGHVHVIDPFWHMLGL 477 (534)
T ss_pred cchhhhhccCccccceecceeEeeHHHHHhcChHHHHHHHHHhcccccccccccccchHHHHHhcCCEEECChhheecCC
Confidence 99999999999999999999999999999999999999999986 3467899999999999999999999999999999
Q ss_pred CCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 542 GYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 542 gy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
||+.+...+.+++|+||||+|++|||+.+++++|+++|.+|++++++|+++|||+
T Consensus 478 g~~~~~~~~~i~~paIIHYnG~~KPW~~~~~~~yr~~W~kYl~~s~~fl~~Cni~ 532 (534)
T PLN02659 478 GYQENTSLADAESAGVVHFNGRAKPWLDIAFPQLRPLWAKYIDSSDKFIKSCHIR 532 (534)
T ss_pred cccccccccccCCcEEEEECCCCCccccccCCcchhHHHHHhccCCHHHHhcCCC
Confidence 9987665667899999999999999999999999999999999999999999996
No 9
>PLN02867 Probable galacturonosyltransferase
Probab=100.00 E-value=6.5e-104 Score=855.32 Aligned_cols=405 Identities=35% Similarity=0.691 Sum_probs=375.2
Q ss_pred HHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHhhccC
Q 007588 192 LRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQATYLVQLASRTT 271 (597)
Q Consensus 192 ~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~la~~~~ 271 (597)
+-.+|++|+++|++.|.++|+++.++.+.|+++++++++.++||++|+.|||||++++||+++++|+|++|++||||+|+
T Consensus 93 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~kl~am~~~~e~~~~~~~~~~~~~~~laa~t~ 172 (535)
T PLN02867 93 KLREELTRALVEAKEQDDGGRGTKGSTESFNDLVKEMTSNRQDIKAFAFRTKAMLLKMERKVQSARQRESIYWHLASHGI 172 (535)
T ss_pred HHHHHHHHHHHHhhhccccCcchhhhhhHHHHHHHHHHhccchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhc
Confidence 44567888999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred CcccchhhhHhchHhhhcCcCCCCCC---CCCCCCCCCceeEEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCH
Q 007588 272 PKGLHCLSMQLTAEYFALQPEERHLP---NQQDLHNPDLHHYAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNL 348 (597)
Q Consensus 272 Pk~~hcl~~rlt~e~~~~~~~~~~~~---~~~~l~d~~~ihIv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~ 348 (597)
|||||||+||||+|||.+.+..++.| +.++++||+.+|+|++|||+||++|||+|++.|+++|++++||||||.+|+
T Consensus 173 PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~~~Hy~ifSdNvLAasVvvnStv~~a~~p~~~VfHvvTD~~ny 252 (535)
T PLN02867 173 PKSLHCLCLKLAEEYAVNAMARSRLPPPESVSRLTDPSFHHVVLLTDNVLAASVVISSTVQNAANPEKLVFHIVTDKKTY 252 (535)
T ss_pred CCCccccchhhHHHHHhCchhhccCCChhhhhhccCCCcceEEEEecceeEEEeeeehhhhcccCccceEEEEecCcccc
Confidence 99999999999999999987666655 445999999999999999999999999999999999999999999999999
Q ss_pred HHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC-----------------------------CCCCCcchhh
Q 007588 349 PAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS-----------------------------HDPRYTSALN 399 (597)
Q Consensus 349 e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s-----------------------------~~~~~~S~~~ 399 (597)
.+|++||.+|++++++|||.++++|+|++.+|+|+++++++ ++|+|+|+++
T Consensus 253 ~aM~~WF~~n~~~~a~v~V~~~~~f~wl~~~~~~v~~~~e~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~pkylS~ln 332 (535)
T PLN02867 253 TPMHAWFAINSIKSAVVEVKGLHQYDWSQEVNVGVKEMLEIHRLIWSHYYQNLKESDFQFEGTHKRSLEALSPSCLSLLN 332 (535)
T ss_pred HHHHHHHhhCCCccceEEEEeehhccccccccccHHHHHHHhhhhhhhhhccccccccccccccccchhhcChhhhhHHH
Confidence 99999999999999999999999999999999998765542 6789999999
Q ss_pred HHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccch--hhhhhhhcccCCCChhhhhccCCCCC
Q 007588 400 HLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESE--ASFRRMDLFINFSDPLIAKKFDVKAC 477 (597)
Q Consensus 400 y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~--~~~~r~~~~Lnfs~P~i~~~fd~~~~ 477 (597)
|+||+||++||+++||||||+||||++||++||++||+|+++|||.|..... +..+++..|+||++|.+..+|+++.|
T Consensus 333 YlRflIPeLLP~LdKVLYLD~DVVVqgDLseLwdiDL~gkviaAV~D~~c~~~~~~~~~~~~YlNfsnp~i~~~~~p~~c 412 (535)
T PLN02867 333 HLRIYIPELFPDLNKIVFLDDDVVVQHDLSSLWELDLNGKVVGAVVDSWCGDNCCPGRKYKDYLNFSHPLISSNLDQERC 412 (535)
T ss_pred HHHHHHHHHhhccCeEEEecCCEEEcCchHHHHhCcCCCCeEEEEeccccccccccchhhhhhccccchhhhccCCCCCc
Confidence 9999999999999999999999999999999999999999999998753211 12356788999999999889999999
Q ss_pred ceecceEEeecHHHHHhhHHHHHHHHHHHcCC--CCCCCCCCcchhhhhhccceeEecccccccccCCCCCC-cccccCC
Q 007588 478 TWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYK--RPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLGYDSGV-ARRDIEQ 554 (597)
Q Consensus 478 yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~--~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy~~~i-~~~~i~~ 554 (597)
|||||||||||++||++++++++++|++++.+ ..+|++|+||+++++|+|+|++||++||+.++||+... ..+.+++
T Consensus 413 YFNSGVmLINL~~WRe~nITek~~~~Le~n~~~~~~l~dqd~LN~~LlvF~g~v~~LD~rWNv~gLgy~~~~~~~~~i~~ 492 (535)
T PLN02867 413 AWLYGMNVFDLKAWRRTNITEAYHKWLKLSLNSGLQLWQPGALPPALLAFKGHVHPIDPSWHVAGLGSRPPEVPREILES 492 (535)
T ss_pred ceecceeeeeHHHHHHhcHHHHHHHHHHhchhcccccccccccchHHHHhcCcEEECChhhcccCCCcccccchhhhcCC
Confidence 99999999999999999999999999998753 57899999999889999999999999999999987532 2345789
Q ss_pred CEEEEecCCCCCcccCCccccHHHHHHHhccCCccccccccC
Q 007588 555 AAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQRCNLH 596 (597)
Q Consensus 555 ~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~~Cn~~ 596 (597)
|+||||+|++|||++.++++|+++|.+|++++++|+|+|||+
T Consensus 493 paIIHYnG~~KPW~e~~~~~yR~~W~kyl~~~~~fl~~cni~ 534 (535)
T PLN02867 493 AAVLHFSGPAKPWLEIGFPEVRSLWYRHVNFSDKFIRKCRIM 534 (535)
T ss_pred cEEEEECCCCCcccccCCCchhHHHHHhcCccchHHHhcccC
Confidence 999999999999999999999999999999999999999996
No 10
>cd06429 GT8_like_1 GT8_like_1 represents a subfamily of GT8 with unknown function. A subfamily of glycosyltransferase family 8 with unknown function: Glycosyltransferase family 8 comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase and inositol 1-alpha-galactosyltransferase. It is classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed.
Probab=100.00 E-value=1.3e-55 Score=449.72 Aligned_cols=246 Identities=47% Similarity=0.878 Sum_probs=219.0
Q ss_pred eeEEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhcc
Q 007588 308 HHYAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKE 387 (597)
Q Consensus 308 ihIv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l 387 (597)
+|||+++||++|++|++.|++.|+++|.+++|||+||+++.+.+++|+...+..+++|+|+.++++.+......+.++++
T Consensus 1 ~hiv~~~Dn~l~~~v~i~S~l~nn~~~~~~~fhvvtd~~s~~~~~~~~~~~~~~~~~i~~~~i~~~~~~~~~~~~~~~~~ 80 (257)
T cd06429 1 IHVVIFSDNRLAAAVVINSSISNNKDPSNLVFHIVTDNQNYGAMRSWFDLNPLKIATVKVLNFDDFKLLGKVKVDSLMQL 80 (257)
T ss_pred CCEEEEecchhHHHHHHHHHHHhCCCCCceEEEEecCccCHHHHHHHHHhcCCCCceEEEEEeCcHHhhcccccchhhhh
Confidence 69999999989999999999999998889999999999999999999999988899999999987665443222233332
Q ss_pred CC---------CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhh
Q 007588 388 NS---------HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMD 458 (597)
Q Consensus 388 ~s---------~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~ 458 (597)
.+ .+++++|.++|+||+||++||+++||||||+|+||++||++||++||+|+++|||+|
T Consensus 81 ~~~~~~~~~~~~~~~~~s~~~y~Rl~ip~llp~~~kvlYLD~Dviv~~dl~eL~~~dl~~~~~aav~d------------ 148 (257)
T cd06429 81 ESEADTSNLKQRKPEYISLLNFARFYLPELFPKLEKVIYLDDDVVVQKDLTELWNTDLGGGVAGAVET------------ 148 (257)
T ss_pred hccccccccccCCccccCHHHHHHHHHHHHhhhhCeEEEEeCCEEEeCCHHHHhhCCCCCCEEEEEhh------------
Confidence 22 467899999999999999999999999999999999999999999999999999975
Q ss_pred cccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCC--CCCCCCCcchhhhhhccceeEecccc
Q 007588 459 LFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKR--PLWKAGSLPLGWVTFYKHTMALDKRW 536 (597)
Q Consensus 459 ~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~--~l~d~~~LpilNi~F~g~i~~Ld~~W 536 (597)
|||||||||||++||++++++++++|++++.+. .++++++|+++|++|+|+++.||++|
T Consensus 149 -------------------yfNsGV~linl~~wr~~~i~~~~~~~~~~~~~~~~~~~~~~dqd~ln~~~~~~~~~L~~~w 209 (257)
T cd06429 149 -------------------SWNPGVNVVNLTEWRRQNVTETYEKWMELNQEEEVTLWKLITLPPGLIVFYGLTSPLDPSW 209 (257)
T ss_pred -------------------hcccceEEEeHHHHHhccHHHHHHHHHHHhhhcccchhhcCCccHHHHHccCeeEECChHH
Confidence 688999999999999999999999999987543 56888999999999999999999999
Q ss_pred cccccCCCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhc
Q 007588 537 HVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFIN 584 (597)
Q Consensus 537 N~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~ 584 (597)
|++++|++.....+.+.+|+||||+|+.|||+..+.++|+++||+|++
T Consensus 210 N~~~l~~~~~~~~~~~~~~~IIHy~G~~KPW~~~~~~~~~~~w~~yl~ 257 (257)
T cd06429 210 HVRGLGYNYGIRPQDIKAAAVLHFNGNMKPWLRTAIPSYKELWEKYLS 257 (257)
T ss_pred cccCCcccccccccccCCcEEEEECCCCCCcCCCCCChHHHHHHHHhC
Confidence 999888876444456779999999999999999998999999999974
No 11
>PRK15171 lipopolysaccharide 1,3-galactosyltransferase; Provisional
Probab=100.00 E-value=1.7e-44 Score=380.79 Aligned_cols=262 Identities=20% Similarity=0.272 Sum_probs=197.8
Q ss_pred CCceeEEEEeCcch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhh
Q 007588 305 PDLHHYAVFSDNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNA 382 (597)
Q Consensus 305 ~~~ihIv~~sDn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~ 382 (597)
++.+|||+++|+.+ +++|+|+|++.|+++ ..++|||++++++.+.++++..+....+..|+++.++. ++
T Consensus 23 ~~~i~Iv~~~D~ny~~~~~vsi~Sil~nn~~-~~~~f~Il~~~is~e~~~~l~~l~~~~~~~i~~~~id~-~~------- 93 (334)
T PRK15171 23 KNSLDIAYGIDKNFLFGCGVSIASVLLNNPD-KSLVFHVFTDYISDADKQRFSALAKQYNTRINIYLINC-ER------- 93 (334)
T ss_pred CCceeEEEECcHhhHHHHHHHHHHHHHhCCC-CCEEEEEEeCCCCHHHHHHHHHHHHhcCCeEEEEEeCH-HH-------
Confidence 46799999999865 599999999999765 47999999999999998887666544466777776653 11
Q ss_pred hhhccCCCCCCCcchhhHHHhhhcccccC-CCeEEEEecCeeeccCcHHhhccCCCCCEEEEe-cccccchhhhhhhhcc
Q 007588 383 TLKKENSHDPRYTSALNHLRFYLPDVFPA-LNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAV-DTCKESEASFRRMDLF 460 (597)
Q Consensus 383 vlk~l~s~~~~~~S~~~y~Rf~IPeLLPe-ldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV-~D~~~~~~~~~r~~~~ 460 (597)
++.+. ...++|.++|+||+||++||+ ++||||||+|+||++||++||++||+|..+||| .|+... .+......
T Consensus 94 -~~~~~--~~~~~s~atY~Rl~ip~llp~~~dkvLYLD~Diiv~~dl~~L~~~dl~~~~~aav~~d~~~~--~~~~~~~~ 168 (334)
T PRK15171 94 -LKSLP--STKNWTYATYFRFIIADYFIDKTDKVLYLDADIACKGSIKELIDLDFAENEIAAVVAEGDAE--WWSKRAQS 168 (334)
T ss_pred -HhCCc--ccCcCCHHHHHHHHHHHhhhhhcCEEEEeeCCEEecCCHHHHHhccCCCCeEEEEEeccchh--HHHHHHHh
Confidence 11111 245899999999999999995 999999999999999999999999997666666 444320 11121222
Q ss_pred cCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcC--CCCCCCCCCcchhhhhhccceeEecccccc
Q 007588 461 INFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGY--KRPLWKAGSLPLGWVTFYKHTMALDKRWHV 538 (597)
Q Consensus 461 Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~--~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~ 538 (597)
++. | +....|||||||||||++||++++++++++++..+. ....+ .||.++|++|.|+++.||++||+
T Consensus 169 l~~--~------~~~~~YFNsGVlliNl~~wRe~~i~~k~~~~l~~~~~~~~~~~--~DQDiLN~~~~~~~~~L~~~wN~ 238 (334)
T PRK15171 169 LQT--P------GLASGYFNSGFLLINIPAWAQENISAKAIEMLADPEIVSRITH--LDQDVLNILLAGKVKFIDAKYNT 238 (334)
T ss_pred cCC--c------cccccceecceEEEcHHHHHHhhHHHHHHHHHhccccccceee--cChhHHHHHHcCCeEECCHhhCC
Confidence 321 1 012469999999999999999999999999998742 22223 34446799999999999999999
Q ss_pred cc-cCCCC--CCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccCCcccc
Q 007588 539 LG-LGYDS--GVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYDHPFLQ 591 (597)
Q Consensus 539 ~~-lgy~~--~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~~pfl~ 591 (597)
+. ..+.. ........+|+||||+|+.|||+..+.++++++||+|+. .+||-.
T Consensus 239 ~~~~~~~~~~~~~~~~~~~p~IIHy~G~~KPW~~~~~~~~~~~f~~~~~-~spw~~ 293 (334)
T PRK15171 239 QFSLNYELKDSVINPVNDETVFIHYIGPTKPWHSWADYPVSQYFLKAKE-ASPWKN 293 (334)
T ss_pred ccchhHHHHhcccccccCCCEEEEECCCCCCCCCCCCCchHHHHHHHHh-cCCCCC
Confidence 73 22211 011122468999999999999998888999999999994 567753
No 12
>cd06431 GT8_LARGE_C LARGE catalytic domain has closest homology to GT8 glycosyltransferase involved in lipooligosaccharide synthesis. The catalytic domain of LARGE is a putative glycosyltransferase. Mutations of LARGE in mouse and human cause dystroglycanopathies, a disease associated with hypoglycosylation of the membrane protein alpha-dystroglycan (alpha-DG) and consequent loss of extracellular ligand binding. LARGE needs to both physically interact with alpha-dystroglycan and function as a glycosyltransferase in order to stimulate alpha-dystroglycan hyperglycosylation. LARGE localizes to the Golgi apparatus and contains three conserved DxD motifs. While two of the motifs are indispensible for glycosylation function, one is important for localization of th eenzyme. LARGE was originally named because it covers approximately large trunck of genomic DNA, more than 600bp long. The predicted protein structure contains an N-terminal cytoplasmic domain, a transmembrane region, a coiled-coil
Probab=100.00 E-value=1.3e-41 Score=350.91 Aligned_cols=263 Identities=18% Similarity=0.294 Sum_probs=193.1
Q ss_pred eeEEEEeCcc-hhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhc
Q 007588 308 HHYAVFSDNV-LACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKK 386 (597)
Q Consensus 308 ihIv~~sDn~-laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~ 386 (597)
+-||++.+++ ..++|+|+|++.|+. ..++|||++++++.+.++.+.......++.|.|+.++++. ..+ ..
T Consensus 3 ~~iv~~~~~y~~~~~~~i~Sil~n~~--~~~~fhii~d~~s~~~~~~l~~~~~~~~~~i~f~~i~~~~---~~~----~~ 73 (280)
T cd06431 3 VAIVCAGYNASRDVVTLVKSVLFYRR--NPLHFHLITDEIARRILATLFQTWMVPAVEVSFYNAEELK---SRV----SW 73 (280)
T ss_pred EEEEEccCCcHHHHHHHHHHHHHcCC--CCEEEEEEECCcCHHHHHHHHHhccccCcEEEEEEhHHhh---hhh----cc
Confidence 4578888665 369999999999985 4699999999999999988887666678999999986421 111 10
Q ss_pred cCCCCCCCcchh-hHHHhhhcccccC-CCeEEEEecCeeeccCcHHhhcc--CCCC-CEEEEecccccchhhhhhhhccc
Q 007588 387 ENSHDPRYTSAL-NHLRFYLPDVFPA-LNKVLLFDHDVVVQSDLGRLWNI--DMKG-KVIGAVDTCKESEASFRRMDLFI 461 (597)
Q Consensus 387 l~s~~~~~~S~~-~y~Rf~IPeLLPe-ldKVLYLD~DvVVq~DLseLw~i--DL~G-kviAAV~D~~~~~~~~~r~~~~L 461 (597)
. ...++|.. +|+||+||++||+ ++||||||+|+||++||++||++ |+.| +++|||+|... .+.......
T Consensus 74 ~---~~~~~s~~y~y~RL~ip~llp~~~dkvLYLD~Diiv~~di~eL~~~~~~~~~~~~~a~v~~~~~---~~~~~~~~~ 147 (280)
T cd06431 74 I---PNKHYSGIYGLMKLVLTEALPSDLEKVIVLDTDITFATDIAELWKIFHKFTGQQVLGLVENQSD---WYLGNLWKN 147 (280)
T ss_pred C---cccchhhHHHHHHHHHHHhchhhcCEEEEEcCCEEEcCCHHHHHHHhhhcCCCcEEEEeccchh---hhhhhhhhc
Confidence 1 12355644 8899999999995 99999999999999999999998 7765 57777776532 111000000
Q ss_pred CCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCC-CCCCCCCCcchhhhhhccc---eeEeccccc
Q 007588 462 NFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYK-RPLWKAGSLPLGWVTFYKH---TMALDKRWH 537 (597)
Q Consensus 462 nfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~-~~l~d~~~LpilNi~F~g~---i~~Ld~~WN 537 (597)
..| +.....|||||||||||++||++++++++..+.+++.. ..-...+||.++|.+|.|+ ++.||++||
T Consensus 148 --~~~-----~~~~~~yFNsGVmlinL~~wR~~~~~~~~~~~~~~~~~~~~~~~~~DQDiLN~v~~~~~~~~~~L~~~wN 220 (280)
T cd06431 148 --HRP-----WPALGRGFNTGVILLDLDKLRKMKWESMWRLTAERELMSMLSTSLADQDIFNAVIKQNPFLVYQLPCAWN 220 (280)
T ss_pred --cCC-----CcccccceeeeeeeeeHHHHHhhCHHHHHHHHHHHHHhhcCCCCcCcHHHHHHHHcCCcceeEECCCccc
Confidence 001 11223599999999999999999999998876655311 1112234555679999999 899999999
Q ss_pred ccccCCC-CCCcccccCCCEEEEecCCCCCcccCCc-cccHHHHHHHhccCCccccc
Q 007588 538 VLGLGYD-SGVARRDIEQAAVIHYDGVMKPWLEIGI-AKYKGYWTKFINYDHPFLQR 592 (597)
Q Consensus 538 ~~~lgy~-~~i~~~~i~~~~IIHY~G~~KPW~~~~~-~~y~~lW~kYl~~~~pfl~~ 592 (597)
++..... ........++|+||||+|+.|||...+. ++|+++|.+|.+++.+-||+
T Consensus 221 ~~~~~~~~~~~~~~~~~~p~IIHf~g~~KPW~~~~~~~~~~~~~~~~~~~~~~~l~~ 277 (280)
T cd06431 221 VQLSDHTRSEQCYRDVSDLKVIHWNSPKKLRVKNKHVEFFRNLYLTFLEYDGNLLRR 277 (280)
T ss_pred cccCccchHhHhhcCcCCCEEEEeCCCCCCCCcCCCChHHHHHHHHHHhcCchhhhh
Confidence 9842111 1001122468999999999999998875 89999999999999887765
No 13
>cd00505 Glyco_transf_8 Members of glycosyltransferase family 8 (GT-8) are involved in lipopolysaccharide biosynthesis and glycogen synthesis. Members of this family are involved in lipopolysaccharide biosynthesis and glycogen synthesis. GT-8 comprises enzymes with a number of known activities: lipopolysaccharide galactosyltransferase, lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase, and N-acetylglucosaminyltransferase. GT-8 enzymes contains a conserved DXD motif which is essential in the coordination of a catalytic divalent cation, most commonly Mn2+.
Probab=100.00 E-value=2.1e-40 Score=334.29 Aligned_cols=237 Identities=19% Similarity=0.252 Sum_probs=183.6
Q ss_pred eeEEEEeCc-ch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhh
Q 007588 308 HHYAVFSDN-VL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATL 384 (597)
Q Consensus 308 ihIv~~sDn-~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vl 384 (597)
||||+++++ .+ +++|+|+|+++|++. .++|||++++++.+..+.+..+....+..++|++++.-.+.. +
T Consensus 1 ~~i~~~a~d~~y~~~~~v~i~Sl~~~~~~--~~~~~il~~~is~~~~~~L~~~~~~~~~~i~~~~~~~~~~~~--~---- 72 (246)
T cd00505 1 IAIVIVATGDEYLRGAIVLMKSVLRHRTK--PLRFHVLTNPLSDTFKAALDNLRKLYNFNYELIPVDILDSVD--S---- 72 (246)
T ss_pred CeEEEEecCcchhHHHHHHHHHHHHhCCC--CeEEEEEEccccHHHHHHHHHHHhccCceEEEEeccccCcch--h----
Confidence 577777766 54 599999999999875 699999999999998888776655568889999886322211 0
Q ss_pred hccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCC
Q 007588 385 KKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFS 464 (597)
Q Consensus 385 k~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs 464 (597)
. ...++++..+|+||+||++||+++||||||+|+||++||++||++|++|+++|||+||.... ....++..++
T Consensus 73 ---~-~~~~~~~~~~y~RL~i~~llp~~~kvlYLD~D~iv~~di~~L~~~~l~~~~~aav~d~~~~~-~~~~~~~~~~-- 145 (246)
T cd00505 73 ---E-HLKRPIKIVTLTKLHLPNLVPDYDKILYVDADILVLTDIDELWDTPLGGQELAAAPDPGDRR-EGKYYRQKRS-- 145 (246)
T ss_pred ---h-hhcCccccceeHHHHHHHHhhccCeEEEEcCCeeeccCHHHHhhccCCCCeEEEccCchhhh-ccchhhcccC--
Confidence 0 11367899999999999999999999999999999999999999999999999999987421 0011111111
Q ss_pred ChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc---eeEeccccccccc
Q 007588 465 DPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH---TMALDKRWHVLGL 541 (597)
Q Consensus 465 ~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~---i~~Ld~~WN~~~l 541 (597)
...+.+||||||||||+++||++++.+++.++..++.+...+ +||+++|.+|.++ +..||++||++..
T Consensus 146 -------~~~~~~yfNsGVmlinl~~~r~~~~~~~~~~~~~~~~~~~~~--~DQd~LN~~~~~~~~~i~~L~~~wN~~~~ 216 (246)
T cd00505 146 -------HLAGPDYFNSGVFVVNLSKERRNQLLKVALEKWLQSLSSLSG--GDQDLLNTFFKQVPFIVKSLPCIWNVRLT 216 (246)
T ss_pred -------CCCCCCceeeeeEEEechHHHHHHHHHHHHHHHHhhcccCcc--CCcHHHHHHHhcCCCeEEECCCeeeEEec
Confidence 234578999999999999999888888888776665433222 3444579999998 9999999999976
Q ss_pred CCCCCC--cccccCCCEEEEecCCCCCcc
Q 007588 542 GYDSGV--ARRDIEQAAVIHYDGVMKPWL 568 (597)
Q Consensus 542 gy~~~i--~~~~i~~~~IIHY~G~~KPW~ 568 (597)
++.... ..+..++|+||||+|+.|||.
T Consensus 217 ~~~~~~~~~~~~~~~~~iiHy~g~~KPW~ 245 (246)
T cd00505 217 GCYRSLNCFKAFVKNAKVIHFNGPTKPWN 245 (246)
T ss_pred CccccccchhhhcCCCEEEEeCCCCCCCC
Confidence 543321 133577999999999999996
No 14
>cd04194 GT8_A4GalT_like A4GalT_like proteins catalyze the addition of galactose or glucose residues to the lipooligosaccharide (LOS) or lipopolysaccharide (LPS) of the bacterial cell surface. The members of this family of glycosyltransferases catalyze the addition of galactose or glucose residues to the lipooligosaccharide (LOS) or lipopolysaccharide (LPS) of the bacterial cell surface. The enzymes exhibit broad substrate specificities. The known functions found in this family include: Alpha-1,4-galactosyltransferase, LOS-alpha-1,3-D-galactosyltransferase, UDP-glucose:(galactosyl) LPS alpha1,2-glucosyltransferase, UDP-galactose: (glucosyl) LPS alpha1,2-galactosyltransferase, and UDP-glucose:(glucosyl) LPS alpha1,2-glucosyltransferase. Alpha-1,4-galactosyltransferase from N. meningitidis adds an alpha-galactose from UDP-Gal (the donor) to a terminal lactose (the acceptor) of the LOS structure of outer membrane. LOSs are virulence factors that enable the organism to evade the immune sys
Probab=100.00 E-value=5.8e-40 Score=330.23 Aligned_cols=238 Identities=20% Similarity=0.251 Sum_probs=188.4
Q ss_pred eeEEEEeCcch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhh
Q 007588 308 HHYAVFSDNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLK 385 (597)
Q Consensus 308 ihIv~~sDn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk 385 (597)
||||+++|+.+ +++|++.|+++|+++ ..++|||++++++.+.++.+.......+..|+++.++.- .+ .
T Consensus 1 ~~I~~~~d~~y~~~~~~~l~Sl~~~~~~-~~~~~~il~~~is~~~~~~L~~~~~~~~~~i~~~~i~~~-----~~----~ 70 (248)
T cd04194 1 MNIVFAIDDNYAPYLAVTIKSILANNSK-RDYDFYILNDDISEENKKKLKELLKKYNSSIEFIKIDND-----DF----K 70 (248)
T ss_pred CCEEEEecHhhHHHHHHHHHHHHhcCCC-CceEEEEEeCCCCHHHHHHHHHHHHhcCCeEEEEEcCHH-----HH----h
Confidence 69999999864 599999999999986 579999999999988887776654445778888887631 11 1
Q ss_pred ccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCC
Q 007588 386 KENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSD 465 (597)
Q Consensus 386 ~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~ 465 (597)
... ....+++..+|+||++|+++|+++||||||+|+||++||++||++|++|+++|||.||.... ..... .
T Consensus 71 ~~~-~~~~~~~~~~y~rl~l~~ll~~~~rvlylD~D~lv~~di~~L~~~~~~~~~~aa~~d~~~~~---~~~~~-~---- 141 (248)
T cd04194 71 FFP-ATTDHISYATYYRLLIPDLLPDYDKVLYLDADIIVLGDLSELFDIDLGDNLLAAVRDPFIEQ---EKKRK-R---- 141 (248)
T ss_pred cCC-cccccccHHHHHHHHHHHHhcccCEEEEEeCCEEecCCHHHHhcCCcCCCEEEEEecccHHH---HHHHH-h----
Confidence 111 13467899999999999999999999999999999999999999999999999999997621 11110 0
Q ss_pred hhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEecccccccccCCCC
Q 007588 466 PLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLGYDS 545 (597)
Q Consensus 466 P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy~~ 545 (597)
........+||||||||+|+++||+.+++++++++++.+.....+ ++|.++|.+|.+++..||.+||++...+..
T Consensus 142 ---~~~~~~~~~yfNsGv~l~nl~~~r~~~~~~~~~~~~~~~~~~~~~--~DQd~LN~~~~~~~~~L~~~~N~~~~~~~~ 216 (248)
T cd04194 142 ---RLGGYDDGSYFNSGVLLINLKKWREENITEKLLELIKEYGGRLIY--PDQDILNAVLKDKILYLPPRYNFQTGFYYL 216 (248)
T ss_pred ---hcCCCcccceeeecchheeHHHHHHhhhHHHHHHHHHhCCCceee--CChHHHHHHHhCCeEEcCcccccchhHhHH
Confidence 012334678999999999999999999999999999997643333 344567999999999999999998654322
Q ss_pred CC--------cccccCCCEEEEecCCCCCccc
Q 007588 546 GV--------ARRDIEQAAVIHYDGVMKPWLE 569 (597)
Q Consensus 546 ~i--------~~~~i~~~~IIHY~G~~KPW~~ 569 (597)
.. .....++|+||||+|+.|||..
T Consensus 217 ~~~~~~~~~~~~~~~~~~~iiHf~g~~KPW~~ 248 (248)
T cd04194 217 LKKKSKEEQELEEARKNPVIIHYTGSDKPWNK 248 (248)
T ss_pred hhccchhHHHHHHHhcCCEEEEeCCCCCCCCC
Confidence 11 1235689999999999999963
No 15
>COG1442 RfaJ Lipopolysaccharide biosynthesis proteins, LPS:glycosyltransferases [Cell envelope biogenesis, outer membrane]
Probab=100.00 E-value=1e-38 Score=334.06 Aligned_cols=259 Identities=19% Similarity=0.269 Sum_probs=200.4
Q ss_pred ceeEEEEeCcch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCC--CceEEEEEccCCcccchhhhh
Q 007588 307 LHHYAVFSDNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPG--KATIQIQSIDNFNWLSTKYNA 382 (597)
Q Consensus 307 ~ihIv~~sDn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~--~~~Ie~i~v~~f~~l~~~~~~ 382 (597)
.++||+++|++| +++|+|.|++.|++. -.+.|||++++++.+.++++....... .+.+.+++++.+.-.+
T Consensus 2 ~~~Iv~a~D~nY~~~~gvsI~SiL~~n~~-~~~~fhil~~~i~~e~~~~l~~~~~~f~~~i~~~~id~~~~~~~~----- 75 (325)
T COG1442 2 TIPIAFAFDKNYLIPAGVSIYSLLEHNRK-IFYKFHILVDGLNEEDKKKLNETAEPFKSFIVLEVIDIEPFLDYP----- 75 (325)
T ss_pred cccEEEEcccccchhHHHHHHHHHHhCcc-ccEEEEEEecCCCHHHHHHHHHHHHhhccceeeEEEechhhhccc-----
Confidence 479999999976 599999999999985 469999999999999999887765443 4555666665543111
Q ss_pred hhhccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccC
Q 007588 383 TLKKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFIN 462 (597)
Q Consensus 383 vlk~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Ln 462 (597)
...+++|.++|+||+||++||+++|+||||+|+||+|||++||.+|++|+++|||.|+.......+-.+
T Consensus 76 -------~~~~~~s~~v~~R~fiadlf~~~dK~lylD~Dvi~~g~l~~lf~~~~~~~~~aaV~D~~~~~~~~~~~~---- 144 (325)
T COG1442 76 -------PFTKRFSKMVLVRYFLADLFPQYDKMLYLDVDVIFCGDLSELFFIDLEEYYLAAVRDVFSHYMKEGALR---- 144 (325)
T ss_pred -------ccccchHHHHHHHHHHHHhccccCeEEEEecCEEEcCcHHHHHhcCCCcceEEEEeehhhhhhhhhhhH----
Confidence 135789999999999999999999999999999999999999999999999999999875210000000
Q ss_pred CCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEecccccccccC
Q 007588 463 FSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLG 542 (597)
Q Consensus 463 fs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lg 542 (597)
.........|||||||++|++.||++++++++++++++.++...+ ++|+++|++|+|++.+||.+||++...
T Consensus 145 ------~~~~~~~~~yFNaG~llinl~~W~~~~i~~k~i~~~~~~~~~~~~--~DQdiLN~i~~~~~~~L~~~YN~~~~~ 216 (325)
T COG1442 145 ------LEKGDLEGSYFNAGVLLINLKLWREENIFEKLIELLKDKENDLLY--PDQDILNMIFEDRVLELPIRYNAIPYI 216 (325)
T ss_pred ------hhhcccccccCccceeeehHHHHHHhhhHHHHHHHHhccccccCC--ccccHHHHHHHhhhhccCcccceeehh
Confidence 011223578999999999999999999999999999776544333 345578999999999999999999532
Q ss_pred -CCCC--CcccccCCCEEEEecCCCCCcccCCccccH-HHHHHHhccCCcccc
Q 007588 543 -YDSG--VARRDIEQAAVIHYDGVMKPWLEIGIAKYK-GYWTKFINYDHPFLQ 591 (597)
Q Consensus 543 -y~~~--i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~-~lW~kYl~~~~pfl~ 591 (597)
+... .......+|.|+||+|+.|||+..+.+.++ .+|...+ ..+||..
T Consensus 217 ~~~~~~~~~~~~~~~~~iiHy~g~~KPW~~~~~~~~~~~~w~~i~-~~~p~~~ 268 (325)
T COG1442 217 DSQLKDKYIYPFGDDPVILHYAGPTKPWHSDSSNYPRSHEWHEIL-AETPWKN 268 (325)
T ss_pred hhccchhhhccCCCCceEEEecCCCCCCcCccccccHHHHHHHHH-hcCCccc
Confidence 1110 012345689999999999999999976654 6666666 4566653
No 16
>PF01501 Glyco_transf_8: Glycosyl transferase family 8; InterPro: IPR002495 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. Glycosyltransferase family 8 GT8 from CAZY comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase (2.4.1.44 from EC), lipopolysaccharide glucosyltransferase 1 (2.4.1.58 from EC), glycogenin glucosyltransferase (2.4.1.186 from EC), inositol 1-alpha-galactosyltransferase (2.4.1.123 from EC). These enzymes have a distant similarity to family GT_24. ; GO: 0016757 transferase activity, transferring glycosyl groups; PDB: 1LL0_D 1ZCV_A 3USR_A 3V90_A 1ZCU_A 1ZCT_A 3V91_A 1ZCY_A 1ZDG_A 1ZDF_A ....
Probab=100.00 E-value=2.7e-36 Score=297.94 Aligned_cols=245 Identities=23% Similarity=0.360 Sum_probs=169.4
Q ss_pred eEEEEeCcch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhc
Q 007588 309 HYAVFSDNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKK 386 (597)
Q Consensus 309 hIv~~sDn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~ 386 (597)
||++++|..+ +++|+++|+++|++++..++|||++++++.+.++.+............+...+. .... .+ .
T Consensus 1 ~i~~~~d~~y~~~~~v~i~Sl~~~~~~~~~~~i~i~~~~~~~~~~~~l~~~~~~~~~~~~~~~~~~-~~~~-~~-----~ 73 (250)
T PF01501_consen 1 HIVLACDDNYLEGAAVLIKSLLKNNPDPSNLHIYIITDDISEEDFEKLRALAAEVIEIEPIEFPDI-SMLE-EF-----Q 73 (250)
T ss_dssp -EEEECSGGGHHHHHHHHHHHHHTTTT-SSEEEEEEESSS-HHHHHHHHHHSCCCCTTECEEETSG-GHHH--------T
T ss_pred CEEEEeCHHHHHHHHHHHHHHHHhccccccceEEEecCCCCHHHHHHHhhhcccccceeeeccchH-Hhhh-hh-----h
Confidence 7999999854 699999999999998778999999999999988887655432221111222111 0000 00 1
Q ss_pred cCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCCh
Q 007588 387 ENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDP 466 (597)
Q Consensus 387 l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P 466 (597)
.......+++..+|+||++|++||+++||||||+|+||.+||++||+++++|+.+|||+|+... ... ....+
T Consensus 74 ~~~~~~~~~~~~~~~rl~i~~ll~~~drilyLD~D~lv~~dl~~lf~~~~~~~~~~a~~~~~~~-----~~~---~~~~~ 145 (250)
T PF01501_consen 74 FNSPSKRHFSPATFARLFIPDLLPDYDRILYLDADTLVLGDLDELFDLDLQGKYLAAVEDESFD-----NFP---NKRFP 145 (250)
T ss_dssp TS-HCCTCGGGGGGGGGGHHHHSTTSSEEEEE-TTEEESS-SHHHHC---TTSSEEEEE----H-----HHH---TSTTS
T ss_pred hcccccccccHHHHHHhhhHHHHhhcCeEEEEcCCeeeecChhhhhcccchhhhccccccchhh-----hhh---hcccc
Confidence 1123557899999999999999999999999999999999999999999999999999993321 110 00000
Q ss_pred hhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEecccccccccCC--C
Q 007588 467 LIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLGLGY--D 544 (597)
Q Consensus 467 ~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~lgy--~ 544 (597)
..........+|||+||||+|+++||++++.+++..+++.+.. ....++|+++|++|++++..||.+||++..++ .
T Consensus 146 ~~~~~~~~~~~~fNsGv~l~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~DQ~~ln~~~~~~~~~L~~~~N~~~~~~~~~ 223 (250)
T PF01501_consen 146 FSERKQPGNKPYFNSGVMLFNPSKWRKENILQKLIEWLEQNGM--KLGFPDQDILNIVFYGNIKPLPCRYNCQPSWYNQS 223 (250)
T ss_dssp SEEECESTTTTSEEEEEEEEEHHHHHHHHHHHHHHHHHHHTTT--T-SSCHHHHHHHHHTTGEEEEEGGGSEEHHHHHHT
T ss_pred hhhcccCcccccccCcEEEEeechhhhhhhhhhhhhhhhhccc--ccCcCchHHHhhhccceeEEECchhcccccccccc
Confidence 0111233468999999999999999999999999999887654 23445666789999999999999999996544 1
Q ss_pred CCCcccccCCCEEEEecCCCCCcccC
Q 007588 545 SGVARRDIEQAAVIHYDGVMKPWLEI 570 (597)
Q Consensus 545 ~~i~~~~i~~~~IIHY~G~~KPW~~~ 570 (597)
........++++||||+|..|||...
T Consensus 224 ~~~~~~~~~~~~iiHy~g~~KPW~~~ 249 (250)
T PF01501_consen 224 DDYFNPILEDAKIIHYSGPPKPWKST 249 (250)
T ss_dssp HHHHHHHGCC-SEEE--SSS-TTSTT
T ss_pred chhhHhhcCCeEEEEeCCCCcCCCCC
Confidence 10112356899999999999999875
No 17
>cd06430 GT8_like_2 GT8_like_2 represents a subfamily of GT8 with unknown function. A subfamily of glycosyltransferase family 8 with unknown function: Glycosyltransferase family 8 comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase and inositol 1-alpha-galactosyltransferase. It is classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed.
Probab=100.00 E-value=2.2e-32 Score=283.76 Aligned_cols=247 Identities=13% Similarity=0.245 Sum_probs=169.2
Q ss_pred EEeCcch-hHHHHHHHHHhhcCCCCcEEEEEEeCC-CCHHHHHHHHhhCCC--CCceEEEEEccCCcccchh-hhhhhhc
Q 007588 312 VFSDNVL-ACAVVVNSTVSFAKEPEKIVFHVVTDS-LNLPAISMWFLLNPP--GKATIQIQSIDNFNWLSTK-YNATLKK 386 (597)
Q Consensus 312 ~~sDn~l-aasVvI~Slv~Na~~p~~i~FHIvtd~-is~e~~~~wf~l~~~--~~~~Ie~i~v~~f~~l~~~-~~~vlk~ 386 (597)
++|++.+ .+-|+|+|++.|+. ..++|||++++ ++.+..+.+...... ..+...++.+. ++.. +
T Consensus 6 v~~g~~~~~~~~~lkSil~~n~--~~l~Fhi~~d~~~~~~~~~~l~~~~~~~~~~i~~~i~~I~----~P~~~~------ 73 (304)
T cd06430 6 VACGERLEETLTMLKSAIVFSQ--KPLRFHIFAEDQLKQSFKEKLDDWPELIDRKFNYTLHPIT----FPSGNA------ 73 (304)
T ss_pred EEcCCcHHHHHHHHHHHHHhCC--CCEEEEEEECCccCHHHHHHHHHHHHhccceeeeEEEEEe----cCccch------
Confidence 3444444 48999999999985 47999999998 554443333222111 22212333331 1111 1
Q ss_pred cCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhcc--CCCCC-EEEEecccccchhhhhhhhcccCC
Q 007588 387 ENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNI--DMKGK-VIGAVDTCKESEASFRRMDLFINF 463 (597)
Q Consensus 387 l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~i--DL~Gk-viAAV~D~~~~~~~~~r~~~~Lnf 463 (597)
+..+..+++.+|+||++|++||+++||||||+|+||.+||++||++ |++|. ++|+|++.... ....+....
T Consensus 74 --~~ws~l~~~~~y~RL~ip~lLp~~dkvLYLD~Dii~~~dI~eL~~~~~df~~~~~aA~v~e~~~~--~~~~~~~~~-- 147 (304)
T cd06430 74 --AEWKKLFKPCAAQRLFLPSLLPDVDSLLYVDTDILFLRPVEEIWSFLKKFNSTQLAAMAPEHEEP--NIGWYNRFA-- 147 (304)
T ss_pred --hhhhhcccHHHHHHHHHHHHhhhhceEEEeccceeecCCHHHHHHHHhhcCCCeEEEEEeccccc--chhhhhhhc--
Confidence 0123456679999999999999999999999999999999999999 99996 55555554321 011111100
Q ss_pred CChhhhhccCCCCCceecceEEeecHHHHH-----------hhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc---e
Q 007588 464 SDPLIAKKFDVKACTWAFGMNLFDLQEWRK-----------RKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH---T 529 (597)
Q Consensus 464 s~P~i~~~fd~~~~yFNSGVmLiNL~kWR~-----------~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~---i 529 (597)
.+| + ....|||||||+|||++||+ .+++++++++++++.....|.+|| ++|++|.++ +
T Consensus 148 ~~~-----~-~~~~gFNSGVmLmNL~~wR~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~DQD--iLN~v~~~~p~~~ 219 (304)
T cd06430 148 RHP-----Y-YGKTGVNSGVMLMNLTRMRRKYFKNDMTPVGLRWEEILMPLYKKYKLKITWGDQD--LINIIFHHNPEML 219 (304)
T ss_pred ccC-----c-ccccccccceeeeeHHHHHhhhcccccchhhhhHHHHHHHHHHhcccCCCCCCHH--HHHHHHcCCCCeE
Confidence 111 1 12357999999999999999 788999999999876555554444 679999998 9
Q ss_pred eEecccccccccC--CCCCCcccccCCCEEEEecCCCCCcccCCccccHHHHHHHhccC
Q 007588 530 MALDKRWHVLGLG--YDSGVARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTKFINYD 586 (597)
Q Consensus 530 ~~Ld~~WN~~~lg--y~~~i~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~kYl~~~ 586 (597)
+.||++||++... |..+....+.+.++|||++++.| .....+.|+.++....+++
T Consensus 220 ~~Lp~~wN~~~d~~~y~~~~~~~~~~~~~~~H~n~~~~--~~~~~~~f~~~~~~~~~~~ 276 (304)
T cd06430 220 YVFPCHWNYRPDHCMYGSNCKAAEEEGVFILHGNRGVY--HSDKQPAFRAVYEAIREYT 276 (304)
T ss_pred EEcCccccCCccceeecccccccccccceEEEcCCCCC--CCccchHHHHHHHHHHhcc
Confidence 9999999988532 22222233457899999998777 4455567888888877765
No 18
>cd06432 GT8_HUGT1_C_like The C-terminal domain of HUGT1-like is highly homologous to the GT 8 family. C-terminal domain of glycoprotein glucosyltransferase (UGT). UGT is a large glycoprotein whose C-terminus contains the catalytic activity. This catalytic C-terminal domain is highly homologous to Glycosyltransferase Family 8 (GT 8) and contains the DXD motif that coordinates donor sugar binding, characteristic for Family 8 glycosyltransferases. GT 8 proteins are retaining enzymes based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed. The non-catalytic N-terminal portion of the human UTG1 (HUGT1) has been shown to monitor the protein folding status and activate its glucosyltransferase activity.
Probab=100.00 E-value=1.6e-32 Score=278.87 Aligned_cols=229 Identities=14% Similarity=0.170 Sum_probs=164.8
Q ss_pred eeEEEEe-Ccch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhh
Q 007588 308 HHYAVFS-DNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATL 384 (597)
Q Consensus 308 ihIv~~s-Dn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vl 384 (597)
|||+... |+.+ +++|++.|+++|+. ..++|||++++++.+..+.+..+....++.++++.++.-.|+.
T Consensus 1 ini~~~~~~~~y~~~~~v~l~Sll~nn~--~~~~fyil~~~is~e~~~~l~~~~~~~~~~i~~i~i~~~~~~~------- 71 (248)
T cd06432 1 INIFSVASGHLYERFLRIMMLSVMKNTK--SPVKFWFIKNFLSPQFKEFLPEMAKEYGFEYELVTYKWPRWLH------- 71 (248)
T ss_pred CeEEEEcCcHHHHHHHHHHHHHHHHcCC--CCEEEEEEeCCCCHHHHHHHHHHHHHhCCceEEEEecChhhhh-------
Confidence 4555444 3444 59999999999985 4799999999999998888776655567889998885212211
Q ss_pred hccCCCCCCCcchhhHHHhhhcccccC-CCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhh--hhhccc
Q 007588 385 KKENSHDPRYTSALNHLRFYLPDVFPA-LNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFR--RMDLFI 461 (597)
Q Consensus 385 k~l~s~~~~~~S~~~y~Rf~IPeLLPe-ldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~--r~~~~L 461 (597)
... ... ....+|.|++++++||. ++||||||+|+||.+||++||++||+|+++|||+||.... ... ++. +.
T Consensus 72 -~~~--~~~-~~~~~y~rL~~~~lLP~~vdkvLYLD~Dilv~~dL~eL~~~dl~~~~~Aav~d~~~~~-~~~~~~~~-~~ 145 (248)
T cd06432 72 -KQT--EKQ-RIIWGYKILFLDVLFPLNVDKVIFVDADQIVRTDLKELMDMDLKGAPYGYTPFCDSRK-EMDGFRFW-KQ 145 (248)
T ss_pred -ccc--ccc-hhHHHHHHHHHHHhhhhccCEEEEEcCCceecccHHHHHhcCcCCCeEEEeeccccch-hcccchhh-hh
Confidence 100 111 13567999999999995 9999999999999999999999999999999999986421 000 110 00
Q ss_pred CCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHH---cCCC-CCCCCCCcchhhhhhccc-eeEecccc
Q 007588 462 NFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQL---GYKR-PLWKAGSLPLGWVTFYKH-TMALDKRW 536 (597)
Q Consensus 462 nfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~---~~~~-~l~d~~~LpilNi~F~g~-i~~Ld~~W 536 (597)
++. ...+ .+..|||||||||||++||++++++++.++++. +... ..+||+. +|.++.++ +++||.+|
T Consensus 146 ~~~----~~~l-~~~~YfNSGVmliNL~~wR~~~i~~~~~~~~~~l~~~~~~l~~~DQDi---LN~v~~~~~i~~Lp~~w 217 (248)
T cd06432 146 GYW----KSHL-RGRPYHISALYVVDLKRFRRIAAGDRLRGQYQQLSQDPNSLANLDQDL---PNNMQHQVPIFSLPQEW 217 (248)
T ss_pred hhh----hhhc-CCCCccceeeEEEeHHHHHHHhHHHHHHHHHHHHhcCCCccccCCchh---hHHHhccCCeEECChHH
Confidence 100 1112 245699999999999999999999977766653 3333 2334444 59999886 99999999
Q ss_pred cccccCCCCCCcccccCCCEEEEecCC
Q 007588 537 HVLGLGYDSGVARRDIEQAAVIHYDGV 563 (597)
Q Consensus 537 N~~~lgy~~~i~~~~i~~~~IIHY~G~ 563 (597)
|++. ++- ..+..+.|.+|||..+
T Consensus 218 ~~~~-~~~---~~~~~~~~~~~~~~~~ 240 (248)
T cd06432 218 LWCE-TWC---SDESKKKAKTIDLCNN 240 (248)
T ss_pred HHHH-HHh---cccccCccceeecccC
Confidence 9973 221 1334678999999874
No 19
>cd02537 GT8_Glycogenin Glycogenin belongs the GT 8 family and initiates the biosynthesis of glycogen. Glycogenin initiates the biosynthesis of glycogen by incorporating glucose residues through a self-glucosylation reaction at a Tyr residue, and then acts as substrate for chain elongation by glycogen synthase and branching enzyme. It contains a conserved DxD motif and an N-terminal beta-alpha-beta Rossmann-like fold that are common to the nucleotide-binding domains of most glycosyltransferases. The DxD motif is essential for coordination of the catalytic divalent cation, most commonly Mn2+. Glycogenin can be classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed. It is placed in glycosyltransferase family 8 which includes lipopolysaccharide glucose and galactose transferases and galactinol synthases.
Probab=99.94 E-value=3.6e-26 Score=230.73 Aligned_cols=217 Identities=14% Similarity=0.110 Sum_probs=153.8
Q ss_pred EEeCc-ch-hHHHHHHHHHhhcCCCCcEEEEEEe-CCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccC
Q 007588 312 VFSDN-VL-ACAVVVNSTVSFAKEPEKIVFHVVT-DSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKEN 388 (597)
Q Consensus 312 ~~sDn-~l-aasVvI~Slv~Na~~p~~i~FHIvt-d~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~ 388 (597)
+++|+ ++ +++|++.|+.+|+.+ +.+||+. ++++.+.++.+.... .+++.++..+... . ..
T Consensus 6 ~~~~~~Y~~~a~vl~~SL~~~~~~---~~~~vl~~~~is~~~~~~L~~~~------~~~~~v~~i~~~~-~----~~--- 68 (240)
T cd02537 6 LLTNDDYLPGALVLGYSLRKVGSS---YDLVVLVTPGVSEESREALEEVG------WIVREVEPIDPPD-S----AN--- 68 (240)
T ss_pred EecChhHHHHHHHHHHHHHhcCCC---CCEEEEECCCCCHHHHHHHHHcC------CEEEecCccCCcc-h----hh---
Confidence 34554 33 599999999999764 4555554 579998887766432 3344444322111 0 00
Q ss_pred CCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCChhh
Q 007588 389 SHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLI 468 (597)
Q Consensus 389 s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i 468 (597)
....+++..+|.||+++++. +++||||||+|+||.+||++||++ +..+|||.|+..
T Consensus 69 -~~~~~~~~~~~~kl~~~~l~-~~drvlylD~D~~v~~~i~~Lf~~---~~~~~a~~d~~~------------------- 124 (240)
T cd02537 69 -LLKRPRFKDTYTKLRLWNLT-EYDKVVFLDADTLVLRNIDELFDL---PGEFAAAPDCGW------------------- 124 (240)
T ss_pred -hccchHHHHHhHHHHhcccc-ccceEEEEeCCeeEccCHHHHhCC---CCceeeecccCc-------------------
Confidence 01235678899999999964 699999999999999999999988 677888876531
Q ss_pred hhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc--eeEecccccccccCCCCC
Q 007588 469 AKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH--TMALDKRWHVLGLGYDSG 546 (597)
Q Consensus 469 ~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~--i~~Ld~~WN~~~lgy~~~ 546 (597)
..|||||||++|++. ++.+.+++++.++.. +..++|.++|.+|.++ +..||.+||++...+...
T Consensus 125 -------~~~fNsGv~l~~~~~----~~~~~~~~~~~~~~~---~~~~DQdiLN~~~~~~~~~~~l~~~yN~~~~~~~~~ 190 (240)
T cd02537 125 -------PDLFNSGVFVLKPSE----ETFNDLLDALQDTPS---FDGGDQGLLNSYFSDRGIWKRLPFTYNALKPLRYLH 190 (240)
T ss_pred -------cccccceEEEEcCCH----HHHHHHHHHHhccCC---CCCCCHHHHHHHHcCCCCEeECCcceeeehhhhccC
Confidence 258999999999965 556777777776543 3345666789999999 999999999985433211
Q ss_pred Cc-ccccCCCEEEEecCCCCCcccCCcc---------ccHHHHHHHh
Q 007588 547 VA-RRDIEQAAVIHYDGVMKPWLEIGIA---------KYKGYWTKFI 583 (597)
Q Consensus 547 i~-~~~i~~~~IIHY~G~~KPW~~~~~~---------~y~~lW~kYl 583 (597)
.. ....++|+||||+|+.|||...+.. .....||+..
T Consensus 191 ~~~~~~~~~~~iiHf~g~~KPW~~~~~~~~~~~~~~~~~~~~w~~~~ 237 (240)
T cd02537 191 PEALWFGDEIKVVHFIGGDKPWSWWRDPETKEKDDYNELHQWWWDIY 237 (240)
T ss_pred chhhcccCCcEEEEEeCCCCCCCCCcCCCcccccchHHHHHHHHHHH
Confidence 11 1234689999999999999877543 3566777765
No 20
>PLN00176 galactinol synthase
Probab=99.92 E-value=4.6e-24 Score=224.54 Aligned_cols=244 Identities=12% Similarity=0.165 Sum_probs=151.1
Q ss_pred eeEEE--EeCc-ch-hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhh
Q 007588 308 HHYAV--FSDN-VL-ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNAT 383 (597)
Q Consensus 308 ihIv~--~sDn-~l-aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~v 383 (597)
..+|. ++|. ++ ++.|+.+|+..+.. ...++ .+++++++.+..+.+... ++ .+++|+... .+.+.
T Consensus 23 ~AyVT~L~~n~~Y~~Ga~vL~~SLr~~~s-~~~lV-vlVt~dVp~e~r~~L~~~----g~--~V~~V~~i~-~~~~~--- 90 (333)
T PLN00176 23 RAYVTFLAGNGDYVKGVVGLAKGLRKVKS-AYPLV-VAVLPDVPEEHRRILVSQ----GC--IVREIEPVY-PPENQ--- 90 (333)
T ss_pred eEEEEEEecCcchHHHHHHHHHHHHHhCC-CCCEE-EEECCCCCHHHHHHHHHc----CC--EEEEecccC-Ccccc---
Confidence 44444 4554 44 58888899987743 22333 445688998766554321 22 334444321 01000
Q ss_pred hhccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhh--hhh---
Q 007588 384 LKKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFR--RMD--- 458 (597)
Q Consensus 384 lk~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~--r~~--- 458 (597)
.+. ..+ .-..+|.||.++++. +++||||||+|+||.++|++||+++ +..+|||.||..+....+ ++.
T Consensus 91 -~~~--~~~--~~~i~~tKl~iw~l~-~ydkvlyLDaD~lv~~nid~Lf~~~--~~~~aAV~dc~~~~~~~~~p~~~~~~ 162 (333)
T PLN00176 91 -TQF--AMA--YYVINYSKLRIWEFV-EYSKMIYLDGDIQVFENIDHLFDLP--DGYFYAVMDCFCEKTWSHTPQYKIGY 162 (333)
T ss_pred -ccc--ccc--hhhhhhhhhhhcccc-ccceEEEecCCEEeecChHHHhcCC--CcceEEEecccccccccccccccccc
Confidence 000 011 113478899999965 6999999999999999999999884 336899999976321001 110
Q ss_pred -----cccCCCChhhhhccC-CCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEe
Q 007588 459 -----LFINFSDPLIAKKFD-VKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMAL 532 (597)
Q Consensus 459 -----~~Lnfs~P~i~~~fd-~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~L 532 (597)
..+++ |. ..+ +...||||||||||++.|+.+++. ++++.+.... + +||.++|.+|.++|.+|
T Consensus 163 c~~~~~~~~w--p~---~~g~~~~~yFNSGVlvinps~~~~~~ll----~~l~~~~~~~-f--~DQD~LN~~F~~~~~~L 230 (333)
T PLN00176 163 CQQCPDKVTW--PA---ELGPPPPLYFNAGMFVFEPSLSTYEDLL----ETLKITPPTP-F--AEQDFLNMFFRDIYKPI 230 (333)
T ss_pred cccchhhccc--hh---hccCCCCCeEEeEEEEEEcCHHHHHHHH----HHHHhcCCCC-C--CCHHHHHHHHcCcEEEC
Confidence 01111 10 111 246799999999999999987665 4555554332 2 44456799999999999
Q ss_pred ccccccccc-CCCCCCcccccCCCEEEEecC-CCCCcccCCcc---------ccHHHHHHHhc
Q 007588 533 DKRWHVLGL-GYDSGVARRDIEQAAVIHYDG-VMKPWLEIGIA---------KYKGYWTKFIN 584 (597)
Q Consensus 533 d~~WN~~~l-gy~~~i~~~~i~~~~IIHY~G-~~KPW~~~~~~---------~y~~lW~kYl~ 584 (597)
|.+||++.. .|.. ...-..++++||||+| ..|||+..+.+ .+-..||..++
T Consensus 231 p~~YN~~~~~~~~~-~~~~~~~~vkIIHY~~~~~KPW~~~~~~~~~~~~~~~~~~~~Ww~~~~ 292 (333)
T PLN00176 231 PPVYNLVLAMLWRH-PENVELDKVKVVHYCAAGSKPWRYTGKEENMDREDIKMLVKKWWDIYN 292 (333)
T ss_pred CchhcCchhhhhhC-hhhcccCCcEEEEeeCCCCCCCCCCCcccCCChHHHHHHHHHHHHHhc
Confidence 999999842 2211 0111246899999997 58999876532 23456887765
No 21
>cd06914 GT8_GNT1 GNT1 is a fungal enzyme that belongs to the GT 8 family. N-acetylglucosaminyltransferase is a fungal enzyme that catalyzes the addition of N-acetyl-D-glucosamine to mannotetraose side chains by an alpha 1-2 linkage during the synthesis of mannan. The N-acetyl-D-glucosamine moiety in mannan plays a role in the attachment of mannan to asparagine residues in proteins. The mannotetraose and its N-acetyl-D-glucosamine derivative side chains of mannan are the principle immunochemical determinants on the cell surface. N-acetylglucosaminyltransferase is a member of glycosyltransferase family 8, which are, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed, retaining glycosyltransferases.
Probab=99.77 E-value=8.3e-18 Score=173.63 Aligned_cols=142 Identities=14% Similarity=0.203 Sum_probs=107.5
Q ss_pred CCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCChhhhhcc
Q 007588 393 RYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLIAKKF 472 (597)
Q Consensus 393 ~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i~~~f 472 (597)
..++. +|.||.++++ ++++||||||+|+||.++|++||+++.. ..+||+. .
T Consensus 75 ~~~~~-~~tKl~~~~l-~~y~kvlyLDaD~l~~~~ideLf~~~~~-~~~Aap~-~------------------------- 125 (278)
T cd06914 75 AYWAK-SLTKLRAFNQ-TEYDRIIYFDSDSIIRHPMDELFFLPNY-IKFAAPR-A------------------------- 125 (278)
T ss_pred ccHHH-HHHHHHhccc-cceeeEEEecCChhhhcChHHHhcCCcc-cceeeec-C-------------------------
Confidence 35554 5999999997 7899999999999999999999998733 3345532 1
Q ss_pred CCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccc-------eeEeccc-ccccccCCC
Q 007588 473 DVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKH-------TMALDKR-WHVLGLGYD 544 (597)
Q Consensus 473 d~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~-------i~~Ld~~-WN~~~lgy~ 544 (597)
..||||||||||++.|+.+++.+++.+...... ..+|| .++|.+|.|. +..||.+ ||++..-+.
T Consensus 126 ---~~~FNSGvmvi~ps~~~~~~l~~~~~~~~~~~~--~~~DQ---diLN~~~~~~~~~~~~~~~~Lp~~~y~llt~~~r 197 (278)
T cd06914 126 ---YWKFASHLMVIKPSKEAFKELMTEILPAYLNKK--NEYDM---DLINEEFYNSKQLFKPSVLVLPHRQYGLLTGEFR 197 (278)
T ss_pred ---cceecceeEEEeCCHHHHHHHHHHHHHhcccCC--CCCCh---HHHHHHHhCCccccCcceEEcCccccccCChhhc
Confidence 018999999999999999999998888654332 22344 4569999999 9999997 999853221
Q ss_pred CC-----C----------c-ccccCCCEEEEecCC--CCCcccCC
Q 007588 545 SG-----V----------A-RRDIEQAAVIHYDGV--MKPWLEIG 571 (597)
Q Consensus 545 ~~-----i----------~-~~~i~~~~IIHY~G~--~KPW~~~~ 571 (597)
.. + + .+.++++++|||++. .|||....
T Consensus 198 ~~~~~~~l~~~~~~~~~w~~~~~~~~~k~vHFSd~Pl~KPW~~~~ 242 (278)
T cd06914 198 EKLHKSFLSNAQHLYEKWDPDDVFKESKVIHFSDSPLPKPWNYNN 242 (278)
T ss_pred ccCHHHhhccccccccccCHHHHHhhCeEEEecCCCCCCCcCCcC
Confidence 11 0 1 123478999999986 69999875
No 22
>KOG1879 consensus UDP-glucose:glycoprotein glucosyltransferase [Carbohydrate transport and metabolism]
Probab=99.15 E-value=7.7e-11 Score=137.73 Aligned_cols=256 Identities=16% Similarity=0.211 Sum_probs=177.8
Q ss_pred CCCCceeEEEEeCcchh---HHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchh
Q 007588 303 HNPDLHHYAVFSDNVLA---CAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTK 379 (597)
Q Consensus 303 ~d~~~ihIv~~sDn~la---asVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~ 379 (597)
.|.+.|+|.-..-..+. +-+++.|+++|++.| +.|+++-.-+|..=.+.+-.++..+++..+++.. +|-.
T Consensus 1177 ~~~~vINIFSvASGHLYERflrIMm~SvlknTktp--VKFWfLkNyLSPtFKe~iP~mA~eYnFeyElv~Y---kWPr-- 1249 (1470)
T KOG1879|consen 1177 KDKEVINIFSVASGHLYERFLRIMMLSVLKNTKTP--VKFWFLKNYLSPTFKESIPHMAKEYNFEYELVQY---KWPR-- 1249 (1470)
T ss_pred CccceEEEEeeccccHHHHHHHHHHHHHHhCCCCc--eeEEeehhhcChHHHHHHHHHHHHhCceEEEEEe---cCch--
Confidence 44557998876666542 889999999999976 9999999998875555554556677888888765 4532
Q ss_pred hhhhhhccCCCCCCCcchhhHHHhhhcccccC-CCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhh
Q 007588 380 YNATLKKENSHDPRYTSALNHLRFYLPDVFPA-LNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMD 458 (597)
Q Consensus 380 ~~~vlk~l~s~~~~~~S~~~y~Rf~IPeLLPe-ldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~ 458 (597)
.|+++.. +.--+..|-=||+.=+||- ++||||.|+|-||+.||.||.+.|++|.+.|-++.|.... .+.
T Consensus 1250 ---WLhqQ~E---KQRiiWgyKILFLDVLFPL~v~KvIfVDADQIVR~DL~EL~dfdl~GaPygYtPfCdsR~----EMD 1319 (1470)
T KOG1879|consen 1250 ---WLHQQTE---KQRIIWGYKILFLDVLFPLNVDKVIFVDADQIVRADLKELMDFDLGGAPYGYTPFCDSRR----EMD 1319 (1470)
T ss_pred ---hhhhhhh---hhhhhhhhhhhhhhhccccccceEEEEcchHhhhhhhHHHHhcccCCCccccCccccccc----ccc
Confidence 3333321 1122456666788889995 9999999999999999999999999999999999997521 222
Q ss_pred cccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHH-cCCC-CCCC-CCCcchhhhhhccceeEeccc
Q 007588 459 LFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQL-GYKR-PLWK-AGSLPLGWVTFYKHTMALDKR 535 (597)
Q Consensus 459 ~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~-~~~~-~l~d-~~~LpilNi~F~g~i~~Ld~~ 535 (597)
.|-.|+..+.++.. .+..|--|...|+||++.|+....+++.-..+. ..+- .+-. +|||| =|+...--|+.||..
T Consensus 1320 GyRFWK~GYW~~hL-~grkYHISALYVVDLkrFReiaAGDrLR~qYQ~LS~DPNSLsNLDQDLP-Nnm~hqVpIkSLPqe 1397 (1470)
T KOG1879|consen 1320 GYRFWKQGYWKKHL-RGRKYHISALYVVDLKRFREIAAGDRLRGQYQALSQDPNSLSNLDQDLP-NNMQHQVPIKSLPQE 1397 (1470)
T ss_pred chhHHhhhHHHHHh-ccCccccceeeeeeHHHHHhcccchHHHHHHHhhcCCcchhhhcccccc-ccceeecccccCCcc
Confidence 33233333333322 357788999999999999999999988754443 3232 2322 57886 366667789999999
Q ss_pred ccccccCCCCCCcccccCCCEEEEecCCCCCcccCC----ccccHHHHHHHh
Q 007588 536 WHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIG----IAKYKGYWTKFI 583 (597)
Q Consensus 536 WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~----~~~y~~lW~kYl 583 (597)
|-+.... .+.+..+++++|--|-+ ||.... ..+.-..|..|-
T Consensus 1398 WLWCETW----C~d~skkkAktIDLCnN--P~TKEpKL~~A~Riv~EW~dyD 1443 (1470)
T KOG1879|consen 1398 WLWCETW----CDDESKKKAKTIDLCNN--PLTKEPKLDAARRIVSEWTDYD 1443 (1470)
T ss_pred hhhhhhh----cCchhhhhchhhhhhcC--ccccchhhHHHhhhcCCCcccc
Confidence 8776432 22334567888888875 776541 123444555553
No 23
>COG5597 Alpha-N-acetylglucosamine transferase [Cell envelope biogenesis, outer membrane]
Probab=98.06 E-value=1.5e-06 Score=90.25 Aligned_cols=154 Identities=17% Similarity=0.230 Sum_probs=85.0
Q ss_pred hhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhc------------------
Q 007588 398 LNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDL------------------ 459 (597)
Q Consensus 398 ~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~------------------ 459 (597)
..+.++-+.+.. ++|||+|||+|.||.+++++||+.. -+-.+|..|.......|+|.+.
T Consensus 155 ~mftKLrVfeqt-EyDRvifLDsDaivlknmDklFd~P--vyef~a~pD~~~sp~~fhrp~~~i~~~ft~~faayg~~r~ 231 (368)
T COG5597 155 DMFTKLRVFEQT-EYDRVIFLDSDAIVLKNMDKLFDYP--VYEFAAAPDVYESPADFHRPNSGIFVSFTPAFAAYGKMRA 231 (368)
T ss_pred HHhHHHHhhhhh-hhceEEEeccchHHhhhhHHHhcch--hhhhccCCchhhCHHHhcCCCCccceeecHHHHhhcccHh
Confidence 455666665643 6999999999999999999999865 3455666664432212333222
Q ss_pred -----ccCCC--Chhh-hhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCC---cchhhhhhc--
Q 007588 460 -----FINFS--DPLI-AKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGS---LPLGWVTFY-- 526 (597)
Q Consensus 460 -----~Lnfs--~P~i-~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~---LpilNi~F~-- 526 (597)
|+++. ++.+ ..-..+-+.+||||.||++..++--..+.. +. .+ .+|++.+ +..+|+.++
T Consensus 232 ~ly~Pylf~a~~dq~~~hstpP~fk~~FnagLmv~~Psk~hm~riv~----~a--lP--klydda~mmeqsllnlaYn~~ 303 (368)
T COG5597 232 ALYAPYLFWARTDQTFLHSTPPDFKLKFNAGLMVGLPSKMHMLRIVW----FA--LP--KLYDDADMMEQSLLNLAYNYE 303 (368)
T ss_pred hhccccccccccCCcccccCCCcHhhhhccCceeecchHHHHHHHHH----Hh--hH--HhhhhhhHHHHHHHHHHHhhh
Confidence 22221 1111 111122467999999999998765333221 11 11 2455221 123466643
Q ss_pred c--ceeEecccccccccCCCCCCcccccCCCEEEEecCCCCCcccCCc
Q 007588 527 K--HTMALDKRWHVLGLGYDSGVARRDIEQAAVIHYDGVMKPWLEIGI 572 (597)
Q Consensus 527 g--~i~~Ld~~WN~~~lgy~~~i~~~~i~~~~IIHY~G~~KPW~~~~~ 572 (597)
| -|..++.+|| ||.. ...++--.+-+|+ |||...+.
T Consensus 304 g~FPwerld~~yN----G~wa--~~ndlPylka~Hg----K~W~y~g~ 341 (368)
T COG5597 304 GFFPWERLDPRYN----GYWA--DANDLPYLKAWHG----KPWFYTGE 341 (368)
T ss_pred ccCchhhcCcccc----cccc--cccccchHHHhhc----CcCCCCcc
Confidence 2 3556667766 4421 1112222345665 99998875
No 24
>PF03407 Nucleotid_trans: Nucleotide-diphospho-sugar transferase; InterPro: IPR005069 Proteins in this family have been been predicted to be nucleotide-diphospho-sugar transferases [].
Probab=95.22 E-value=0.07 Score=52.63 Aligned_cols=141 Identities=16% Similarity=0.073 Sum_probs=75.4
Q ss_pred cchhhHHHhh-hcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCChhhhhccC
Q 007588 395 TSALNHLRFY-LPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLIAKKFD 473 (597)
Q Consensus 395 ~S~~~y~Rf~-IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i~~~fd 473 (597)
+......|.- +-+++..=--|+|+|+|+|..+|..++++ -.+.-+.+..|+.... ...
T Consensus 48 ~~~~~~~K~~~~~~~L~~G~~vl~~D~Dvv~~~dp~~~~~--~~~~Di~~~~d~~~~~-------------------~~~ 106 (212)
T PF03407_consen 48 FQKLTWLKPKVLLDLLELGYDVLFSDADVVWLRDPLPYFE--NPDADILFSSDGWDGT-------------------NSD 106 (212)
T ss_pred HHHHHHHHHHHHHHHHHcCCceEEecCCEEEecCcHHhhc--cCCCceEEecCCCccc-------------------chh
Confidence 3444555543 34556543459999999999999999992 1344444444554310 001
Q ss_pred CCCCceecceEEeecHHHHHhhHHHHHHHHHHHcCCC-CCCCCCCcchhhhhhcc--------ceeEecccccccccCCC
Q 007588 474 VKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKR-PLWKAGSLPLGWVTFYK--------HTMALDKRWHVLGLGYD 544 (597)
Q Consensus 474 ~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~~~~-~l~d~~~LpilNi~F~g--------~i~~Ld~~WN~~~lgy~ 544 (597)
.....+|+|++.+--.. ....-+..|....... ..++| .++|.++.. ++..||...-..|.+|-
T Consensus 107 ~~~~~~n~G~~~~r~t~----~~~~~~~~w~~~~~~~~~~~DQ---~~~n~~l~~~~~~~~~~~~~~L~~~~f~~g~~~f 179 (212)
T PF03407_consen 107 RNGNLVNTGFYYFRPTP----RTIAFLEDWLERMAESPGCWDQ---QAFNELLREQAARYGGLRVRFLPPSLFPNGHGYF 179 (212)
T ss_pred hcCCccccceEEEecCH----HHHHHHHHHHHHHHhCCCcchH---HHHHHHHHhcccCCcCcEEEEeCHHHeeccccce
Confidence 12334599999996554 1222233444443222 23444 455766654 35666665443343331
Q ss_pred CC-Ccccc---cCCCEEEEecCC
Q 007588 545 SG-VARRD---IEQAAVIHYDGV 563 (597)
Q Consensus 545 ~~-i~~~~---i~~~~IIHY~G~ 563 (597)
.. ..... ...|.+||.++.
T Consensus 180 ~~~~~~~~~~~~~~p~~vH~n~~ 202 (212)
T PF03407_consen 180 CQSRDWAWVPTKNKPYIVHANCC 202 (212)
T ss_pred eecchhhhhccccccceEEEcCC
Confidence 11 01111 357999999974
No 25
>PLN03182 xyloglucan 6-xylosyltransferase; Provisional
Probab=94.02 E-value=0.46 Score=52.17 Aligned_cols=164 Identities=15% Similarity=0.198 Sum_probs=88.9
Q ss_pred CCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchhhhhhhhcccCCCChhhhh
Q 007588 391 DPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEASFRRMDLFINFSDPLIAK 470 (597)
Q Consensus 391 ~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~~~~r~~~~Lnfs~P~i~~ 470 (597)
.+..|+...++|=.+-. +|+.+-+.|||.|.||..- -+.+.+..+ .+... ..+ |+. ..
T Consensus 178 ~p~~WaKlpaLR~aM~~-~PeaEWiWWLDsDALImNm---sfelPlery-----~~~Nl---Vih------g~~----~~ 235 (429)
T PLN03182 178 MAGFWAKLPLLRKLMLA-HPEVEWIWWMDSDALFTDM---TFEIPLEKY-----EGYNL---VIH------GWD----EL 235 (429)
T ss_pred CCcchhHHHHHHHHHHH-CCCceEEEEecCCceeecC---CCCCCHhHc-----CCcCe---eec------cch----hh
Confidence 35678877777765543 7999999999999999862 112222211 00000 000 010 01
Q ss_pred cc-CCCCCceecceEEeecHHHHHhhHHHHHHHHHHHc-----------------CCCCCCCCCCcchhhhhh------c
Q 007588 471 KF-DVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQLG-----------------YKRPLWKAGSLPLGWVTF------Y 526 (597)
Q Consensus 471 ~f-d~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~~-----------------~~~~l~d~~~LpilNi~F------~ 526 (597)
.+ ..+-.+.|+|+++|-.-.|--. +.+ .|.... .++..+..++|.++-.++ +
T Consensus 236 l~~~kdW~GLNtGsFLIRNcqWSld-lLD---aWa~mgp~~~~~~~~g~~l~~~l~~rp~~eaDDQSAlvyLl~~~~~~w 311 (429)
T PLN03182 236 VYDQKSWIGLNTGSFLIRNCQWSLD-LLD---AWAPMGPKGPIRDEAGKILTAELKGRPAFEADDQSALVYLLLTQRERW 311 (429)
T ss_pred heeccccCccceeeEEEEcCHHHHH-HHH---HHHhcCCCCchhhhHHHHHHHhhcCCCCCCcccHHHHHHHHHhcchhh
Confidence 12 2356799999999988887643 212 233332 244555555555443333 2
Q ss_pred cceeEecccccccccC------CCCC---C--cccccCCCEEEEecCCCCCcccCCccccHHHHHH
Q 007588 527 KHTMALDKRWHVLGLG------YDSG---V--ARRDIEQAAVIHYDGVMKPWLEIGIAKYKGYWTK 581 (597)
Q Consensus 527 g~i~~Ld~~WN~~~lg------y~~~---i--~~~~i~~~~IIHY~G~~KPW~~~~~~~y~~lW~k 581 (597)
+.-..|...|-+.|.. |... . ...+-.-|-|.||+| .||....+.-+-..-|..
T Consensus 312 ~~kv~le~~y~l~Gyw~~iv~~yee~~~~~~~g~gd~rwPfvtHF~G-ckpC~~~~~y~~~~C~~~ 376 (429)
T PLN03182 312 GDKVYLENSYYLHGYWVGLVDRYEEMMEKYHPGLGDDRWPFVTHFVG-CKPCGGYGDYPVERCLKQ 376 (429)
T ss_pred ccceEEeecceeccccHHHHHHHHHHHHhcCCCCCCcccceeEeecc-ceecCCCCCcCHHHHHHH
Confidence 2335666666665421 1110 0 112335689999999 899966553333444443
No 26
>PF11051 Mannosyl_trans3: Mannosyltransferase putative; InterPro: IPR022751 Alpha-mannosyltransferase is responsible for the addition of residues to the outer chain of core N-linked polysaccharides and to O-linked mannotriose. It is implicated in late Golgi modifications [][][]. The proteins matching this entry are conserved in fungi and also found in some phototrophic organisms.; GO: 0006486 protein glycosylation
Probab=92.87 E-value=0.34 Score=50.42 Aligned_cols=108 Identities=15% Similarity=0.135 Sum_probs=62.7
Q ss_pred EEEEeCc-chhH-HHHHHHHHhhcCCCCcEEEEEEe-CCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhc
Q 007588 310 YAVFSDN-VLAC-AVVVNSTVSFAKEPEKIVFHVVT-DSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKK 386 (597)
Q Consensus 310 Iv~~sDn-~laa-sVvI~Slv~Na~~p~~i~FHIvt-d~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~ 386 (597)
||++.-+ .... ..+|+.+ +.....-.|.+..-. ++++.+..+.++. ...|.++++... +.+++.
T Consensus 4 IVi~~g~~~~~~a~~lI~~L-R~~g~~LPIEI~~~~~~dl~~~~~~~l~~-----~q~v~~vd~~~~--~~~~~~----- 70 (271)
T PF11051_consen 4 IVITAGDKYLWLALRLIRVL-RRLGNTLPIEIIYPGDDDLSKEFCEKLLP-----DQDVWFVDASCV--IDPDYL----- 70 (271)
T ss_pred EEEEecCccHHHHHHHHHHH-HHhCCCCCEEEEeCCccccCHHHHHHHhh-----hhhhheecceEE--eecccc-----
Confidence 5555555 3443 3455555 445544456655555 6788887777664 334555555431 111111
Q ss_pred cCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccC
Q 007588 387 ENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNID 435 (597)
Q Consensus 387 l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iD 435 (597)
...+....|..=.+.-++-.++.||+||+|.|...|++.||+.+
T Consensus 71 -----~~~~~~~~~~~K~lA~l~ssFeevllLDaD~vpl~~p~~lF~~~ 114 (271)
T PF11051_consen 71 -----GKSFSKKGFQNKWLALLFSSFEEVLLLDADNVPLVDPEKLFESE 114 (271)
T ss_pred -----ccccccCCchhhhhhhhhCCcceEEEEcCCcccccCHHHHhcCc
Confidence 01011003333344556777999999999999999999999853
No 27
>PF05637 Glyco_transf_34: galactosyl transferase GMA12/MNN10 family; InterPro: IPR008630 This family contains a number of glycosyltransferase enzymes that contain a DXD motif. This family includes a number of Caenorhabditis elegans homologues where the DXD is replaced by DXH. Some members of this family are included in glycosyltransferase family 34.; GO: 0016758 transferase activity, transferring hexosyl groups, 0016021 integral to membrane; PDB: 2P72_B 2P73_A 2P6W_A.
Probab=86.47 E-value=0.42 Score=48.94 Aligned_cols=97 Identities=11% Similarity=0.035 Sum_probs=18.1
Q ss_pred cchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEE--ecccccchhhhhhhhcccCCCChhhhh-c
Q 007588 395 TSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGA--VDTCKESEASFRRMDLFINFSDPLIAK-K 471 (597)
Q Consensus 395 ~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAA--V~D~~~~~~~~~r~~~~Lnfs~P~i~~-~ 471 (597)
|+..-.+|=.+ .-+|+.+-|+|||+|.+|..-=-+|-+.=|+...+-- ..|.... ......+..+..++.-.. .
T Consensus 61 W~K~~~lr~~m-~~~P~~~wv~~lD~Dali~n~~~~L~~~il~p~~L~~~~~r~~~~~--p~~~~~~~~~~~~~~~~~li 137 (239)
T PF05637_consen 61 WAKIPALRAAM-KKYPEAEWVWWLDSDALIMNPDFSLEEHILSPSRLDSLLLRDVPIV--PPDSIIKTYSVIDGNDIHLI 137 (239)
T ss_dssp HTHHHHHHHHH-HH-TT-SEEEEE-TTEEE--------------------------------------------------
T ss_pred hHHHHHHHHHH-HhCCCCCEEEEEcCCeEEEecccccccccccccccccccccccccc--cccccccccccccccccccc
Confidence 44444444333 2358999999999999998644443322111111100 0111000 000111111111111001 1
Q ss_pred cCCCCCceecceEEeecHHHHHh
Q 007588 472 FDVKACTWAFGMNLFDLQEWRKR 494 (597)
Q Consensus 472 fd~~~~yFNSGVmLiNL~kWR~~ 494 (597)
...+..++|+|++++-...|-..
T Consensus 138 ~t~d~~gLNtGsFliRns~ws~~ 160 (239)
T PF05637_consen 138 ITQDWNGLNTGSFLIRNSPWSRD 160 (239)
T ss_dssp -----------------------
T ss_pred ccccccccccccccccccccccc
Confidence 23467899999999988777653
No 28
>cd02514 GT13_GLCNAC-TI GT13_GLCNAC-TI is involved in an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. Alpha-1,3-mannosyl-glycoprotein beta-1,2-N-acetylglucosaminyltransferase (GLCNAC-T I , GNT-I) transfers N-acetyl-D-glucosamine from UDP to high-mannose glycoprotein N-oligosaccharide, an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. The enzyme is an integral membrane protein localized to the Golgi apparatus. The catalytic domain is located at the C-terminus. These proteins are members of the glycosy transferase family 13.
Probab=82.41 E-value=6.2 Score=42.64 Aligned_cols=114 Identities=15% Similarity=0.153 Sum_probs=67.4
Q ss_pred eEEEE-eCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhcc
Q 007588 309 HYAVF-SDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKE 387 (597)
Q Consensus 309 hIv~~-sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l 387 (597)
+|+++ ++..-++.-+|.|++++........++|..|+-..+......... .+++ .+...+ +...+ + ..
T Consensus 3 PVlv~ayNRp~~l~r~LesLl~~~p~~~~~~liIs~DG~~~~~~~~v~~~~--~~i~-~i~~~~-~~~~~-----~--~~ 71 (334)
T cd02514 3 PVLVIACNRPDYLRRMLDSLLSYRPSAEKFPIIVSQDGGYEEVADVAKSFG--DGVT-HIQHPP-ISIKN-----V--NP 71 (334)
T ss_pred CEEEEecCCHHHHHHHHHHHHhccccCCCceEEEEeCCCchHHHHHHHhhc--cccE-EEEccc-ccccc-----c--Cc
Confidence 44444 444557999999999975223457889998987655443322211 1222 121111 11000 0 00
Q ss_pred CCCCCCCcchhhHHHhhhcccccC--CCeEEEEecCeeeccCcHHhhc
Q 007588 388 NSHDPRYTSALNHLRFYLPDVFPA--LNKVLLFDHDVVVQSDLGRLWN 433 (597)
Q Consensus 388 ~s~~~~~~S~~~y~Rf~IPeLLPe--ldKVLYLD~DvVVq~DLseLw~ 433 (597)
......|..++.|++.-+-.+|-. +++||+||+|+++--|.=+.++
T Consensus 72 ~~~~~~y~~ia~hyk~aln~vF~~~~~~~vIILEDDl~~sPdFf~yf~ 119 (334)
T cd02514 72 PHKFQGYYRIARHYKWALTQTFNLFGYSFVIILEDDLDIAPDFFSYFQ 119 (334)
T ss_pred ccccchhhHHHHHHHHHHHHHHHhcCCCEEEEECCCCccCHhHHHHHH
Confidence 001124567788888888888865 8999999999999999554443
No 29
>COG4575 ElaB Uncharacterized conserved protein [Function unknown]
Probab=79.51 E-value=8.1 Score=34.94 Aligned_cols=75 Identities=19% Similarity=0.211 Sum_probs=60.3
Q ss_pred chHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCCh-HHHHHHHHHHHHHHHHHHHHHHhhh
Q 007588 184 SHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDC-SAMATKLRAMTYNAEERVRLQKNQA 260 (597)
Q Consensus 184 ~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~-~~~~~kl~~~~~~~e~~~~~~~~~~ 260 (597)
.++.-||+.-+.++|.+|..+...+ -.++.+.=.+.+..|.++|...-+- ..++.+-|+++..+|+-|+.+-=|+
T Consensus 11 ~~l~~el~~L~d~lEevL~ssg~~a--~~e~~~lR~r~~~~Lk~~r~rl~~~~d~v~~~sk~a~~~tD~yV~e~PWq~ 86 (104)
T COG4575 11 DQLLAELQELLDTLEEVLKSSGSLA--GDEAEELRSKAESALKEARDRLGDTGDAVVQRSKAAADATDDYVRENPWQG 86 (104)
T ss_pred HHHHHHHHHHHHHHHHHHHhcccch--hhHHHHHHHHHHHHHHHHHHHHHhhhhHHHHHHHHHHHHHHHHHHcCCchH
Confidence 6788899999999999999886554 3355555556688888888877777 7889999999999999999776554
No 30
>PF03071 GNT-I: GNT-I family; InterPro: IPR004139 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. Alpha-1,3-mannosyl-glycoprotein beta-1,2-N-acetylglucosaminyltransferase (GNT-I, GLCNAC-T I) 2.4.1.101 from EC transfers N-acetyl-D-glucosamine from UDP to high-mannose glycoprotein N-oligosaccharide. This is an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. The enzyme is an integral membrane protein localized to the Golgi apparatus, and is probably distributed in all tissues. The catalytic domain is located at the C terminus []. These proteins are members of the glycosyl transferase family 13 (GH13 from CAZY); GO: 0003827 alpha-1,3-mannosylglycoprotein 2-beta-N-acetylglucosaminyltransferase activity, 0006487 protein N-linked glycosylation, 0000139 Golgi membrane; PDB: 2APC_A 2AM4_A 1FO9_A 2AM3_A 1FOA_A 2AM5_A 1FO8_A.
Probab=78.49 E-value=7.9 Score=43.26 Aligned_cols=117 Identities=14% Similarity=0.185 Sum_probs=63.3
Q ss_pred cee-EEEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhh
Q 007588 307 LHH-YAVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLK 385 (597)
Q Consensus 307 ~ih-Iv~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk 385 (597)
.++ +||+|+..-++.-+|.|++++....+.+.+.|--|+-+.+..+.... +.+ .+..+.-.++..+. +..
T Consensus 94 ~~pVlV~AcNRp~yl~r~L~sLl~~rp~~~~fpIiVSQDg~~~~~~~vi~~---y~~-~v~~i~~~~~~~i~-----~~~ 164 (434)
T PF03071_consen 94 VIPVLVFACNRPDYLRRTLDSLLKYRPSAEKFPIIVSQDGDDEEVAEVIKS---YGD-QVTYIQHPDFSPIT-----IPP 164 (434)
T ss_dssp ---EEEEESS-TT-HHHHHHHHHHH-S-TTTS-EEEEE-TT-HHHHHHHHG---GGG-GSEEEE-S--S----------T
T ss_pred cceEEEEecCCcHHHHHHHHHHHHcCCCCCCccEEEEecCCcHHHHHHHHH---hhh-hheeeecCCcCCce-----eCc
Confidence 344 45666667789999999999875445666666667766554443322 211 12222111111100 000
Q ss_pred ccCCCCCCCcchhhHHHhhhcccccC--CCeEEEEecCeeeccCcHHhhc
Q 007588 386 KENSHDPRYTSALNHLRFYLPDVFPA--LNKVLLFDHDVVVQSDLGRLWN 433 (597)
Q Consensus 386 ~l~s~~~~~~S~~~y~Rf~IPeLLPe--ldKVLYLD~DvVVq~DLseLw~ 433 (597)
. +.....|+.++.|++.-|-.+|.. +++||.|.+|+.|--|.=+.|+
T Consensus 165 ~-~~~~~~y~~IA~HYk~aL~~vF~~~~~~~vIIlEDDL~isPDFf~Yf~ 213 (434)
T PF03071_consen 165 K-EKKFKGYYKIARHYKWALSQVFNKFKYSSVIILEDDLEISPDFFEYFS 213 (434)
T ss_dssp T--GGGHHHHHHHHHHHHHHHHHHHTS--SEEEEEETTEEE-TTHHHHHH
T ss_pred c-cccccchHHHHHHHHHHHHHHHHhcCCceEEEEecCcccCccHHHHHH
Confidence 0 000124567899999999999964 8999999999999999877665
No 31
>cd02515 Glyco_transf_6 Glycosyltransferase family 6 comprises enzymes responsible for the production of the human ABO blood group antigens. Glycosyltransferase family 6, GT_6, comprises enzymes with three known activities: alpha-1,3-galactosyltransferase, alpha-1,3 N-acetylgalactosaminyltransferase, and alpha-galactosyltransferase. UDP-galactose:beta-galactosyl alpha-1,3-galactosyltransferase (alpha3GT) catalyzes the transfer of galactose from UDP-alpha-d-galactose into an alpha-1,3 linkage with beta-galactosyl groups in glycoconjugates. The enzyme exists in most mammalian species but is absent from humans, apes, and old world monkeys as a result of the mutational inactivation of the gene. The alpha-1,3 N-acetylgalactosaminyltransferase and alpha-galactosyltransferase are responsible for the production of the human ABO blood group antigens. A N-acetylgalactosaminyltransferases use a UDP-GalNAc donor to convert the H-antigen acceptor to the A antigen, whereas a galactosyltransferase use
Probab=74.84 E-value=79 Score=33.38 Aligned_cols=194 Identities=13% Similarity=0.120 Sum_probs=104.4
Q ss_pred ceeEEEEeCcchh--HHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccC-Ccccchhhhhh
Q 007588 307 LHHYAVFSDNVLA--CAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDN-FNWLSTKYNAT 383 (597)
Q Consensus 307 ~ihIv~~sDn~la--asVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~-f~~l~~~~~~v 383 (597)
.|-|.+++-..|. .---+.|.=++=-...++.+||+||.-..-. ......+.++.++.+.+ -.|
T Consensus 35 tIgl~vfatGkY~~f~~~F~~SAEk~Fm~g~~v~YyVFTD~~~~~p-----~v~lg~~r~~~V~~v~~~~~W-------- 101 (271)
T cd02515 35 TIGLTVFAVGKYTEFLERFLESAEKHFMVGYRVIYYIFTDKPAAVP-----EVELGPGRRLTVLKIAEESRW-------- 101 (271)
T ss_pred EEEEEEEEeccHHHHHHHHHHHHHHhccCCCeeEEEEEeCCcccCc-----ccccCCCceeEEEEeccccCC--------
Confidence 3555555555443 4456667766665556789999999653210 11122345677777632 223
Q ss_pred hhccCCCCCCCcchhhHHHhh------hcccccCCCeEEEEecCeeeccCcH-HhhccCCCCCEEEEecccccch--h--
Q 007588 384 LKKENSHDPRYTSALNHLRFY------LPDVFPALNKVLLFDHDVVVQSDLG-RLWNIDMKGKVIGAVDTCKESE--A-- 452 (597)
Q Consensus 384 lk~l~s~~~~~~S~~~y~Rf~------IPeLLPeldKVLYLD~DvVVq~DLs-eLw~iDL~GkviAAV~D~~~~~--~-- 452 (597)
...+..|+- ...++-++|-+.++|+|+++++++. |. | |..+|...-..-.. .
T Consensus 102 ------------~~~sl~Rm~~~~~~~~~~~~~e~DYlF~~dvd~~F~~~ig~E~----L-g~lva~lHp~~y~~~~~~f 164 (271)
T cd02515 102 ------------QDISMRRMKTLADHIADRIGHEVDYLFCMDVDMVFQGPFGVET----L-GDSVAQLHPWWYGKPRKQF 164 (271)
T ss_pred ------------cHHHHHHHHHHHHHHHHhhcccCCEEEEeeCCceEeecCCHHH----h-hhhheecChhhhcCCCCCC
Confidence 233333332 2335667999999999999999886 22 2 23444432111000 0
Q ss_pred hhhhhhcccCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHH---cCCCCCCCCCCcchhhhhhc-cc
Q 007588 453 SFRRMDLFINFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQL---GYKRPLWKAGSLPLGWVTFY-KH 528 (597)
Q Consensus 453 ~~~r~~~~Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~---~~~~~l~d~~~LpilNi~F~-g~ 528 (597)
.|.|-.+ |..+| .++.+..|+.+|++==-.++.. ++++.|..-+.. +.-...|.+..- +|-.|- ++
T Consensus 165 pYERrp~----S~AyI--p~~eGdfYy~Ga~~GG~~~~vl--~l~~~c~~~i~~D~~n~I~A~wHDESH--LNkYf~~~K 234 (271)
T cd02515 165 PYERRPS----SAAYI--PEGEGDFYYHGAVFGGSVEEVY--RLTRACHEGILADKANGIEARWHDESH--LNKYFLLHK 234 (271)
T ss_pred CCcCCCC----ccccc--cCCCCCeEEeeeecCccHHHHH--HHHHHHHHHHHHHHhCCceEEeecHhH--hHHHHhhCC
Confidence 0111000 10111 2445677888887744444333 345666655544 222346765542 476664 44
Q ss_pred -eeEecccccccc
Q 007588 529 -TMALDKRWHVLG 540 (597)
Q Consensus 529 -i~~Ld~~WN~~~ 540 (597)
++.|++.|+.-.
T Consensus 235 p~KiLSPeY~w~e 247 (271)
T cd02515 235 PTKVLSPEYLWDD 247 (271)
T ss_pred CCeecChhhcCCc
Confidence 899999988763
No 32
>PLN03181 glycosyltransferase; Provisional
Probab=74.12 E-value=14 Score=41.06 Aligned_cols=36 Identities=19% Similarity=0.187 Sum_probs=27.3
Q ss_pred CCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC
Q 007588 391 DPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD 427 (597)
Q Consensus 391 ~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D 427 (597)
.+..|+..-..|=.+-. +|+.+-+.|||.|+||...
T Consensus 179 ~p~~WaKipalRaAM~a-~PeAEWfWWLDsDALIMNp 214 (453)
T PLN03181 179 MNSYWAKLPVVRAAMLA-HPEAEWIWWVDSDAVFTDM 214 (453)
T ss_pred CchhhhHHHHHHHHHHH-CCCceEEEEecCCceeecC
Confidence 34567777777744422 8999999999999999854
No 33
>KOG1950 consensus Glycosyl transferase, family 8 - glycogenin [Carbohydrate transport and metabolism]
Probab=73.86 E-value=3.7 Score=44.64 Aligned_cols=153 Identities=9% Similarity=-0.000 Sum_probs=78.8
Q ss_pred ccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccchh--hhhhhhc-ccCCCChh-----hhhccCC--CCCc
Q 007588 409 FPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKESEA--SFRRMDL-FINFSDPL-----IAKKFDV--KACT 478 (597)
Q Consensus 409 LPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~~~--~~~r~~~-~Lnfs~P~-----i~~~fd~--~~~y 478 (597)
|.++++++|+|.|+.+-.+....+++-.. ...+...|..-.. ..-.++. +.+..++. ..+.+.. ..+.
T Consensus 122 ~~~~~a~i~~~~~i~~~~~~~~~~~v~~~--~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~f~~~~~~~~~~~l~~~ 199 (369)
T KOG1950|consen 122 LIEDGAAIYLVDDIQRFRNDDANFDVPNE--LNYAKLYMFQLDFYSKLVKIDADDCILKNDDLLFSNWPDLFATNILPLI 199 (369)
T ss_pred eeccCceEEEecchhhccCccccccccch--hcccccceeeecccccceEEeccchhcCChhhhhhhchhhccCCCccce
Confidence 56789999999999999999998876432 1222233321100 0001111 11111110 0122333 3455
Q ss_pred eecceEEeecHHHHHhhHHHHHHHHHHHcCCCCCCCCCCcchhhhhhccceeEecccccccc-cCCCCC--Cccccc--C
Q 007588 479 WAFGMNLFDLQEWRKRKLTAVYHKYLQLGYKRPLWKAGSLPLGWVTFYKHTMALDKRWHVLG-LGYDSG--VARRDI--E 553 (597)
Q Consensus 479 FNSGVmLiNL~kWR~~nitek~~~~l~~~~~~~l~d~~~LpilNi~F~g~i~~Ld~~WN~~~-lgy~~~--i~~~~i--~ 553 (597)
||+|++++-.... .+..++........+.++++..+|..|...-.+.++..|..- ..+... ...... .
T Consensus 200 ~n~~~~v~~ps~~-------~~~~~~~~~~~~~~~~~~~q~~l~~~f~~~~~~~~~~~n~~~~~~~~~p~~~~l~~~~~~ 272 (369)
T KOG1950|consen 200 FNSGLLVFEPSLC-------NYKDLMEFSEEFESYNGADQGFLHLIFSWIPDRPPPSVNLNLAKLWRHPKKNDLSRASSV 272 (369)
T ss_pred eccCccccCCCcc-------chhhHHHhhcccCCCCCccchhhHHHhhcccCCCcccccccccccccCccccchhhcccc
Confidence 9999999854332 222233333333344555555567888765558888888763 222111 111111 1
Q ss_pred CCEEEEecCCCCCcccC
Q 007588 554 QAAVIHYDGVMKPWLEI 570 (597)
Q Consensus 554 ~~~IIHY~G~~KPW~~~ 570 (597)
.-..+||.|..|||...
T Consensus 273 ~~~~~~y~~~~~p~~~~ 289 (369)
T KOG1950|consen 273 LRYALHYLGANKPELCY 289 (369)
T ss_pred cchhhhccccCCCCccc
Confidence 22346999976777543
No 34
>PF03414 Glyco_transf_6: Glycosyltransferase family 6; InterPro: IPR005076 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. Glycosyltransferase family 6 GT6 from CAZY comprises enzymes with three known activities; alpha-1,3-galactosyltransferase (2.4.1.151 from EC); alpha-1,3 N-acetylgalactosaminyltransferase (2.4.1.40 from EC); alpha-galactosyltransferase (2.4.1.37 from EC).; GO: 0016758 transferase activity, transferring hexosyl groups, 0005975 carbohydrate metabolic process, 0016020 membrane; PDB: 2Y7A_B 2O1G_A 1R82_A 2RJ1_A 3IOJ_B 2RJ4_A 3I0C_A 3SX8_A 1ZJ1_A 3I0E_A ....
Probab=72.66 E-value=61 Score=35.23 Aligned_cols=199 Identities=14% Similarity=0.141 Sum_probs=97.5
Q ss_pred eeEEEEeCcch-h-HHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCC-cccchhhhhhh
Q 007588 308 HHYAVFSDNVL-A-CAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNF-NWLSTKYNATL 384 (597)
Q Consensus 308 ihIv~~sDn~l-a-asVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f-~~l~~~~~~vl 384 (597)
|-+++++=..+ . .---+.|.=++=-..-++.+||+||..+.-. .+....+-++.++.+... .|-+ . .+
T Consensus 101 IGL~vfA~GkY~~fl~~Fl~SAek~Fm~g~~V~YYVFTD~p~~vP-----~i~l~~~r~~~V~~v~~~~~Wqd--~--sm 171 (337)
T PF03414_consen 101 IGLTVFATGKYIVFLKDFLESAEKHFMVGHRVIYYVFTDQPSKVP-----RIELGPGRRLKVFEVQEEKRWQD--I--SM 171 (337)
T ss_dssp EEEEEEE-CCHHHHHHHHHHHHHHHBSTTSEEEEEEEES-GGGS-----------TTEEEEEEE-SGGSSHHH--H--HH
T ss_pred EEEEEEecccHHHHHHHHHHhHHHhccCCcEEEEEEEeCchhhCC-----ccccCCCceeEEEEecccCCCcc--c--hh
Confidence 44444444433 2 5567777777766667899999999764211 011123456777776532 2211 0 00
Q ss_pred hccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhccCCCCCEEEEecccccc--hhh--hhhhhcc
Q 007588 385 KKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWNIDMKGKVIGAVDTCKES--EAS--FRRMDLF 460 (597)
Q Consensus 385 k~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~iDL~GkviAAV~D~~~~--~~~--~~r~~~~ 460 (597)
.-+.++..+-.-.++-++|-+.++|+|+++++++.. +.=|..+|...--.-. ... +.|-.+
T Consensus 172 ----------~Rm~~i~~~i~~~~~~EvDYLFc~dvd~~F~~~vGv----E~Lg~lva~LHp~~y~~~~~~FpYERrp~- 236 (337)
T PF03414_consen 172 ----------MRMEMISEHIEQHIQHEVDYLFCMDVDMVFQDHVGV----EILGDLVATLHPWFYFKPRESFPYERRPK- 236 (337)
T ss_dssp ----------HHHHHHHHHHHHCHHHH-SEEEEEESSEEE-S-B-G----GG-SSEEEEESTTTTTSTGGGS--B-STT-
T ss_pred ----------HHHHHHHHHHHHHHhhcCCEEEEEecceEEecccCH----HHHHHHHHHhCHHHHCCChhhCccccCcc-
Confidence 012233333344567789999999999999998864 1116677765432110 000 111000
Q ss_pred cCCCChhhhhccCCCCCceecceEEeecHHHHHhhHHHHHHHHHHH---cCCCCCCCCCCcchhhhhhc-c-ceeEeccc
Q 007588 461 INFSDPLIAKKFDVKACTWAFGMNLFDLQEWRKRKLTAVYHKYLQL---GYKRPLWKAGSLPLGWVTFY-K-HTMALDKR 535 (597)
Q Consensus 461 Lnfs~P~i~~~fd~~~~yFNSGVmLiNL~kWR~~nitek~~~~l~~---~~~~~l~d~~~LpilNi~F~-g-~i~~Ld~~ 535 (597)
|..+| .++.+..|+.+|++==-..+.. ++++.|+.-+.. +.-...|.+.. -+|-.|- + -++.|++.
T Consensus 237 ---S~AyI--p~~eGDfYY~ga~fGGt~~~vl--~Lt~~c~~~i~~D~~n~I~A~WhDES--HLNKYfl~~KPtKvLSPE 307 (337)
T PF03414_consen 237 ---SQAYI--PYGEGDFYYHGAFFGGTVEEVL--RLTEACHQGIMQDKANGIEALWHDES--HLNKYFLYHKPTKVLSPE 307 (337)
T ss_dssp ---STTB----TT--S--EECCEEEECHHHHH--HHHHHHHHHHHHHHHTT---TTCHHH--HHHHHHHHS--SEEE-GG
T ss_pred ---ccccc--cCCCCCeEEeceecCCcHHHHH--HHHHHHHHHHHhhhhcCceEeccchh--hhHHHHhhCCCceecCHH
Confidence 11111 1455677888888765444443 456667665544 33346786554 3577663 3 48999999
Q ss_pred cccc
Q 007588 536 WHVL 539 (597)
Q Consensus 536 WN~~ 539 (597)
|+.-
T Consensus 308 Y~Wd 311 (337)
T PF03414_consen 308 YCWD 311 (337)
T ss_dssp GSBS
T ss_pred HccC
Confidence 8875
No 35
>PRK10132 hypothetical protein; Provisional
Probab=67.25 E-value=32 Score=31.37 Aligned_cols=76 Identities=12% Similarity=0.059 Sum_probs=59.0
Q ss_pred chHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHhhhH
Q 007588 184 SHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKNQAT 261 (597)
Q Consensus 184 ~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~ 261 (597)
++|..||+.-+.++|.++.++..++ -+.+.+.=.+.+..|..||+...|...+..+.|.+...+++-++.+--++.
T Consensus 15 e~L~~Dl~~L~~~le~ll~~~~~~~--~~~~~~lR~r~~~~L~~ar~~l~~~~~~~~~~~~a~~~~~~~V~~~Pw~sv 90 (108)
T PRK10132 15 QDIQNDVNQLADSLESVLKSWGSDA--KGEAEAARRKAQALLKETRARMHGRTRVQQAARDAVGCADTFVRERPWCSV 90 (108)
T ss_pred HHHHHHHHHHHHHHHHHHHHHhhhh--HHHHHHHHHHHHHHHHHHHHHHhhhHHHHHHHHHHHHHHHHHHHhCcHHHH
Confidence 6888899999999999887665443 234445555568889999988888888878889999999999997766653
No 36
>PF04488 Gly_transf_sug: Glycosyltransferase sugar-binding region containing DXD motif ; InterPro: IPR007577 This entry represents those sugar-binding regions of glycosyltransferases that contain a DXD motif. The DXD motif is a short conserved motif found in many families of glycosyltransferases, which add a range of different sugars to other sugars, phosphates and proteins. DXD-containing glycosyltransferases all use nucleoside diphosphate sugars as donors and require divalent cations, usually manganese. The DXD motif is expected to play a carbohydrate binding role in sugar-nucleoside diphosphate and manganese dependent glycosyltransferases [].
Probab=66.05 E-value=4.2 Score=35.82 Aligned_cols=36 Identities=19% Similarity=0.346 Sum_probs=28.4
Q ss_pred CCcchhhHHHhhhcccccCCCeEEEEecCeeeccCc-HHhh
Q 007588 393 RYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDL-GRLW 432 (597)
Q Consensus 393 ~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DL-seLw 432 (597)
.+.....++|+.+--..-. ||+|.|+++.+++ +.+-
T Consensus 61 ~~~~~sD~~R~~~L~~~GG----iY~D~D~~~~rpl~~~~~ 97 (103)
T PF04488_consen 61 NYAHKSDLLRYLVLYKYGG----IYLDLDVICLRPLDDPWL 97 (103)
T ss_pred chHHHHHHHHHHHHHHcCc----EEEeCccccCcchhhhhh
Confidence 3445688999998666666 8999999999999 5543
No 37
>cd00761 Glyco_tranf_GTA_type Glycosyltransferase family A (GT-A) includes diverse families of glycosyl transferases with a common GT-A type structural fold. Glycosyltransferases (GTs) are enzymes that synthesize oligosaccharides, polysaccharides, and glycoconjugates by transferring the sugar moiety from an activated nucleotide-sugar donor to an acceptor molecule, which may be a growing oligosaccharide, a lipid, or a protein. Based on the stereochemistry of the donor and acceptor molecules, GTs are classified as either retaining or inverting enzymes. To date, all GT structures adopt one of two possible folds, termed GT-A fold and GT-B fold. This hierarchy includes diverse families of glycosyl transferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. The majority of the proteins in this superfamily are Glycosyltransferase family 2 (GT-2) proteins. But it als
Probab=59.96 E-value=98 Score=26.48 Aligned_cols=95 Identities=9% Similarity=-0.047 Sum_probs=51.6
Q ss_pred EEEeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCCC
Q 007588 311 AVFSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENSH 390 (597)
Q Consensus 311 v~~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s~ 390 (597)
+.+.+..-.+.-++.|+..... ....++|++++.+.+....+...... ...+..+...
T Consensus 3 i~~~~~~~~l~~~l~s~~~~~~--~~~~i~i~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~------------------- 60 (156)
T cd00761 3 IPAYNEEPYLERCLESLLAQTY--PNFEVIVVDDGSTDGTLEILEEYAKK-DPRVIRVINE------------------- 60 (156)
T ss_pred EeecCcHHHHHHHHHHHHhCCc--cceEEEEEeCCCCccHHHHHHHHHhc-CCCeEEEEec-------------------
Confidence 3444444446778889888765 35788899888776665555444322 0111111110
Q ss_pred CCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHh
Q 007588 391 DPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRL 431 (597)
Q Consensus 391 ~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseL 431 (597)
.......-....+... ..+.++++|+|.++..+.-+-
T Consensus 61 --~~~g~~~~~~~~~~~~--~~d~v~~~d~D~~~~~~~~~~ 97 (156)
T cd00761 61 --ENQGLAAARNAGLKAA--RGEYILFLDADDLLLPDWLER 97 (156)
T ss_pred --CCCChHHHHHHHHHHh--cCCEEEEECCCCccCccHHHH
Confidence 0111111111222222 579999999999998775443
No 38
>KOG1928 consensus Alpha-1,4-N-acetylglucosaminyltransferase [Carbohydrate transport and metabolism]
Probab=56.09 E-value=5.6 Score=43.56 Aligned_cols=33 Identities=27% Similarity=0.338 Sum_probs=24.3
Q ss_pred hhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhc
Q 007588 397 ALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWN 433 (597)
Q Consensus 397 ~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~ 433 (597)
..+..|+.+=.=+-. ||||+|+||.++++.|=+
T Consensus 227 lSdl~RLA~LyKYGG----vYLDTDvIvLksl~~l~N 259 (409)
T KOG1928|consen 227 LSDLSRLALLYKYGG----VYLDTDVIVLKSLSNLRN 259 (409)
T ss_pred HHHHHHHHHHHHhCC----EEeeccEEEecccccccc
Confidence 356677765332333 799999999999999865
No 39
>PF00535 Glycos_transf_2: Glycosyl transferase family 2; InterPro: IPR001173 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. This domain is found in a diverse family of glycosyl transferases that transfer the sugar from UDP-glucose, UDP-N-acetyl-galactosamine, GDP-mannose or CDP-abequose, to a range of substrates including cellulose, dolichol phosphate and teichoic acids.; PDB: 2Z87_A 2Z86_B 2D7R_A 2D7I_A 3CKN_A 3CKQ_A 3CKJ_A 3CKV_A 3CKO_A 2FFU_A ....
Probab=55.82 E-value=1.1e+02 Score=26.92 Aligned_cols=96 Identities=11% Similarity=0.007 Sum_probs=52.8
Q ss_pred EeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCCCCC
Q 007588 313 FSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENSHDP 392 (597)
Q Consensus 313 ~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s~~~ 392 (597)
+.+..-.+.-++.|+..... ....+.|+.|+-+.+.......... ....++++..++-
T Consensus 6 ~~n~~~~l~~~l~sl~~q~~--~~~eiivvdd~s~d~~~~~~~~~~~-~~~~i~~i~~~~n------------------- 63 (169)
T PF00535_consen 6 TYNEAEYLERTLESLLKQTD--PDFEIIVVDDGSTDETEEILEEYAE-SDPNIRYIRNPEN------------------- 63 (169)
T ss_dssp ESS-TTTHHHHHHHHHHHSG--CEEEEEEEECS-SSSHHHHHHHHHC-CSTTEEEEEHCCC-------------------
T ss_pred eeCCHHHHHHHHHHHhhccC--CCEEEEEeccccccccccccccccc-ccccccccccccc-------------------
Confidence 33333347788889988833 3688888888765444333322222 4455666655420
Q ss_pred CCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhcc
Q 007588 393 RYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWNI 434 (597)
Q Consensus 393 ~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~i 434 (597)
.....-....+ +.-. -+-++++|+|.++..+ |..|.+.
T Consensus 64 --~g~~~~~n~~~-~~a~-~~~i~~ld~D~~~~~~~l~~l~~~ 102 (169)
T PF00535_consen 64 --LGFSAARNRGI-KHAK-GEYILFLDDDDIISPDWLEELVEA 102 (169)
T ss_dssp --SHHHHHHHHHH-HH---SSEEEEEETTEEE-TTHHHHHHHH
T ss_pred --ccccccccccc-cccc-eeEEEEeCCCceEcHHHHHHHHHH
Confidence 11111112222 2222 3599999999999988 7888874
No 40
>cd04186 GT_2_like_c Subfamily of Glycosyltransferase Family GT2 of unknown function. GT-2 includes diverse families of glycosyltransferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. These are enzymes that catalyze the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. Glycosyltransferases have been classified into more than 90 distinct sequence based families.
Probab=52.16 E-value=1.6e+02 Score=26.14 Aligned_cols=86 Identities=15% Similarity=0.110 Sum_probs=47.5
Q ss_pred hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCCCCCCCcchh
Q 007588 319 ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENSHDPRYTSAL 398 (597)
Q Consensus 319 aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s~~~~~~S~~ 398 (597)
.+.-++.|+..... ....+.|+.|+-..+....+....+ .+.++..+. + ....
T Consensus 11 ~l~~~l~sl~~~~~--~~~~iiivdd~s~~~~~~~~~~~~~----~~~~~~~~~------~---------------~g~~ 63 (166)
T cd04186 11 YLKACLDSLLAQTY--PDFEVIVVDNASTDGSVELLRELFP----EVRLIRNGE------N---------------LGFG 63 (166)
T ss_pred HHHHHHHHHHhccC--CCeEEEEEECCCCchHHHHHHHhCC----CeEEEecCC------C---------------cChH
Confidence 47788999988765 2467778877766554444333221 333332221 0 0001
Q ss_pred hHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhc
Q 007588 399 NHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWN 433 (597)
Q Consensus 399 ~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~ 433 (597)
.-...-+... ..+-++++|+|.++..+ +..+++
T Consensus 64 ~a~n~~~~~~--~~~~i~~~D~D~~~~~~~l~~~~~ 97 (166)
T cd04186 64 AGNNQGIREA--KGDYVLLLNPDTVVEPGALLELLD 97 (166)
T ss_pred HHhhHHHhhC--CCCEEEEECCCcEECccHHHHHHH
Confidence 1111112121 57899999999999766 555555
No 41
>PF10819 DUF2564: Protein of unknown function (DUF2564) ; InterPro: IPR020314 This entry contains proteins with no known function.
Probab=50.15 E-value=89 Score=27.03 Aligned_cols=69 Identities=19% Similarity=0.268 Sum_probs=53.8
Q ss_pred HHHHHHHHHHHHhhcccC--CCCcccHHHHHHHHHHHHHHHHhhccc--CChHHHHHHHHHHHHHHHHHHHHHH
Q 007588 188 KELKLRIKEVERAVGAAT--KDSDLSRRAFRRMNQMEATLDKASHVY--PDCSAMATKLRAMTYNAEERVRLQK 257 (597)
Q Consensus 188 ~el~~~~~e~~~~~~~~~--~~~~~~~~~~~~~~~m~~~~~~~~~~~--~~~~~~~~kl~~~~~~~e~~~~~~~ 257 (597)
+++.-.|+-.|+++|-|| .|.++-+++.+.++.-..-|.+|++.. .|- .+...=...|+..|-|+..+|
T Consensus 6 kQve~aVetAqkmvG~AT~smdp~~Le~A~qAve~Ar~ql~~a~~~at~lD~-~Fl~~~~~~L~~~eHQL~Eak 78 (79)
T PF10819_consen 6 KQVEMAVETAQKMVGQATMSMDPDQLEHATQAVEDAREQLSQAKSHATGLDE-PFLQQSEQLLDDCEHQLDEAK 78 (79)
T ss_pred HHHHHHHHHHHHHHHHHHhcCCHHHHHHHHHHHHHHHHHHHHHHHHHhCCcH-HHHHHHHHHHHHHHHHHHHhc
Confidence 577778888999999995 455566788888888888888888665 444 677788888899998888655
No 42
>TIGR02977 phageshock_pspA phage shock protein A. Members of this family are the phage shock protein PspA, from the phage shock operon. This is a narrower family than the set of PspA and its homologs, sometimes several in a genome, as described by PFAM model pfam04012. PspA appears to maintain the protonmotive force under stress conditions that include overexpression of certain phage secretins, heat shock, ethanol, and protein export defects.
Probab=49.07 E-value=59 Score=32.83 Aligned_cols=109 Identities=13% Similarity=0.152 Sum_probs=73.0
Q ss_pred cccCcHHHHHHhhHHHHHHHHHH--hhCCCCCCchHHHHHHHHHHHHHHhhccc--CCCCcccHHHHHHHHHHHHHHHHh
Q 007588 153 LLRVSDEKIKEMKDQVIRAQAYL--NFAPPGSNSHLVKELKLRIKEVERAVGAA--TKDSDLSRRAFRRMNQMEATLDKA 228 (597)
Q Consensus 153 ~~~~~d~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~el~~~~~e~~~~~~~~--~~~~~~~~~~~~~~~~m~~~~~~~ 228 (597)
|..+-|..++.|+|+|.-||.=+ .+|....-.+=..++...+.+.+.-..-| .++.+|-..+......-+..+...
T Consensus 25 P~~~l~q~irem~~~l~~ar~~lA~~~a~~k~~e~~~~~~~~~~~~~~~~A~~Al~~G~EdLAr~Al~~k~~~~~~~~~l 104 (219)
T TIGR02977 25 PEKMIRLIIQEMEDTLVEVRTTSARTIADKKELERRVSRLEAQVADWQEKAELALSKGREDLARAALIEKQKAQELAEAL 104 (219)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHH
Confidence 44578899999999998888744 44444433444455666666654322222 234557777766666667777777
Q ss_pred hcccCChHHHHHHHHHHHHHHHHHHHHHHhhhH
Q 007588 229 SHVYPDCSAMATKLRAMTYNAEERVRLQKNQAT 261 (597)
Q Consensus 229 ~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~ 261 (597)
+...-.-...+.+|+.-+..++.++...+.+..
T Consensus 105 ~~~~~~~~~~v~~l~~~l~~L~~ki~~~k~k~~ 137 (219)
T TIGR02977 105 ERELAAVEETLAKLQEDIAKLQAKLAEARARQK 137 (219)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 767777788888999999999988887665543
No 43
>cd06423 CESA_like CESA_like is the cellulose synthase superfamily. The cellulose synthase (CESA) superfamily includes a wide variety of glycosyltransferase family 2 enzymes that share the common characteristic of catalyzing the elongation of polysaccharide chains. The members include cellulose synthase catalytic subunit, chitin synthase, glucan biosynthesis protein and other families of CESA-like proteins. Cellulose synthase catalyzes the polymerization reaction of cellulose, an aggregate of unbranched polymers of beta-1,4-linked glucose residues in plants, most algae, some bacteria and fungi, and even some animals. In bacteria, algae and lower eukaryotes, there is a second unrelated type of cellulose synthase (Type II), which produces acylated cellulose, a derivative of cellulose. Chitin synthase catalyzes the incorporation of GlcNAc from substrate UDP-GlcNAc into chitin, which is a linear homopolymer of beta-(1,4)-linked GlcNAc residues and Glucan Biosynthesis protein catalyzes the
Probab=48.20 E-value=1.6e+02 Score=25.76 Aligned_cols=32 Identities=16% Similarity=0.145 Sum_probs=22.2
Q ss_pred hhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHH
Q 007588 318 LACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAI 351 (597)
Q Consensus 318 laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~ 351 (597)
-.+.-++.|++.... ....+.|+.++-+....
T Consensus 10 ~~l~~~l~sl~~q~~--~~~~iivvdd~s~d~t~ 41 (180)
T cd06423 10 AVIERTIESLLALDY--PKLEVIVVDDGSTDDTL 41 (180)
T ss_pred HHHHHHHHHHHhCCC--CceEEEEEeCCCccchH
Confidence 346778899988765 35788888877665443
No 44
>cd06439 CESA_like_1 CESA_like_1 is a member of the cellulose synthase (CESA) superfamily. This is a subfamily of cellulose synthase (CESA) superfamily. CESA superfamily includes a wide variety of glycosyltransferase family 2 enzymes that share the common characteristic of catalyzing the elongation of polysaccharide chains. The members of the superfamily include cellulose synthase catalytic subunit, chitin synthase, glucan biosynthesis protein and other families of CESA-like proteins.
Probab=46.46 E-value=2.2e+02 Score=27.97 Aligned_cols=103 Identities=11% Similarity=0.046 Sum_probs=56.3
Q ss_pred CceeEEEEeCcc-hhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhh
Q 007588 306 DLHHYAVFSDNV-LACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATL 384 (597)
Q Consensus 306 ~~ihIv~~sDn~-laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vl 384 (597)
..+-|++.+=|. -.+.-+|.|+......+..+.+.|+.|+-+............. .+.++..+.
T Consensus 29 ~~isVvip~~n~~~~l~~~l~si~~q~~~~~~~eiivvdd~s~d~t~~~~~~~~~~---~v~~i~~~~------------ 93 (251)
T cd06439 29 PTVTIIIPAYNEEAVIEAKLENLLALDYPRDRLEIIVVSDGSTDGTAEIAREYADK---GVKLLRFPE------------ 93 (251)
T ss_pred CEEEEEEecCCcHHHHHHHHHHHHhCcCCCCcEEEEEEECCCCccHHHHHHHHhhC---cEEEEEcCC------------
Confidence 346677776664 3477888998876544334677777776654444332222221 244433221
Q ss_pred hccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhcc
Q 007588 385 KKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWNI 434 (597)
Q Consensus 385 k~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~i 434 (597)
+. +...-....+... .-+-|+++|+|+++..+ |..+++.
T Consensus 94 ------~~---g~~~a~n~gi~~a--~~d~i~~lD~D~~~~~~~l~~l~~~ 133 (251)
T cd06439 94 ------RR---GKAAALNRALALA--TGEIVVFTDANALLDPDALRLLVRH 133 (251)
T ss_pred ------CC---ChHHHHHHHHHHc--CCCEEEEEccccCcCHHHHHHHHHH
Confidence 00 1111112222222 23889999999999866 7777765
No 45
>PRK10807 paraquat-inducible protein B; Provisional
Probab=45.17 E-value=77 Score=36.65 Aligned_cols=44 Identities=11% Similarity=0.184 Sum_probs=25.1
Q ss_pred cccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHH
Q 007588 209 DLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQ 256 (597)
Q Consensus 209 ~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~ 256 (597)
.+|.++.+.+++++.++..++ .|.. .-..|++++..+++-+++.
T Consensus 473 ~Lp~~L~~TL~~l~~~l~~~~---~~s~-~~~~l~~tl~~l~~~~r~l 516 (547)
T PRK10807 473 QLPADMQKTLRELNRSMQGFQ---PGSP-AYNKMVADMQRLDQVLREL 516 (547)
T ss_pred HHHHHHHHHHHHHHHHHhhcC---CCCh-HHHHHHHHHHHHHHHHHHH
Confidence 356666666666666665543 3333 3356666666666666643
No 46
>cd06434 GT2_HAS Hyaluronan synthases catalyze polymerization of hyaluronan. Hyaluronan synthases (HASs) are bi-functional glycosyltransferases that catalyze polymerization of hyaluronan. HASs transfer both GlcUA and GlcNAc in beta-(1,3) and beta-(1,4) linkages, respectively to the hyaluronan chain using UDP-GlcNAc and UDP-GlcUA as substrates. HA is made as a free glycan, not attached to a protein or lipid. HASs do not need a primer for HA synthesis; they initiate HA biosynthesis de novo with only UDP-GlcNAc, UDP-GlcUA, and Mg2+. Hyaluronan (HA) is a linear heteropolysaccharide composed of (1-3)-linked beta-D-GlcUA-beta-D-GlcNAc disaccharide repeats. It can be found in vertebrates and a few microbes and is typically on the cell surface or in the extracellular space, but is also found inside mammalian cells. Hyaluronan has several physiochemical and biological functions such as space filling, lubrication, and providing a hydrated matrix through which cells can migrate.
Probab=44.72 E-value=2.2e+02 Score=27.53 Aligned_cols=105 Identities=19% Similarity=0.171 Sum_probs=57.1
Q ss_pred eEEEEeCc-c-hhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhc
Q 007588 309 HYAVFSDN-V-LACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKK 386 (597)
Q Consensus 309 hIv~~sDn-~-laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~ 386 (597)
-|++.+=| . -.+.-+|.|+.... .+.+.|+.++-+.+....+....... .+.++.-+.
T Consensus 3 sVvIp~~ne~~~~l~~~l~sl~~q~----~~eiivvdd~s~d~~~~~l~~~~~~~--~~~v~~~~~-------------- 62 (235)
T cd06434 3 TVIIPVYDEDPDVFRECLRSILRQK----PLEIIVVTDGDDEPYLSILSQTVKYG--GIFVITVPH-------------- 62 (235)
T ss_pred EEEEeecCCChHHHHHHHHHHHhCC----CCEEEEEeCCCChHHHHHHHhhccCC--cEEEEecCC--------------
Confidence 34555444 4 34778899999865 36788888877765554442222222 233322111
Q ss_pred cCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhccCCCCCEEEEe
Q 007588 387 ENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWNIDMKGKVIGAV 444 (597)
Q Consensus 387 l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~iDL~GkviAAV 444 (597)
...... ...-+.. ...+-|++||+|+++..| |..+... +...-+|+|
T Consensus 63 -----~g~~~a---~n~g~~~--a~~d~v~~lD~D~~~~~~~l~~l~~~-~~~~~v~~v 110 (235)
T cd06434 63 -----PGKRRA---LAEGIRH--VTTDIVVLLDSDTVWPPNALPEMLKP-FEDPKVGGV 110 (235)
T ss_pred -----CChHHH---HHHHHHH--hCCCEEEEECCCceeChhHHHHHHHh-ccCCCEeEE
Confidence 110011 1111111 257999999999999877 7777764 223334444
No 47
>PF05704 Caps_synth: Capsular polysaccharide synthesis protein; InterPro: IPR008441 This entry consists of several capsular polysaccharide proteins. Capsular polysaccharide (CPS) is a major virulence factor in Streptococcus pneumoniae. This family is often transcribed with putative glycosyl transferases to give rise to bifunctional proteins [].
Probab=44.28 E-value=37 Score=35.65 Aligned_cols=99 Identities=15% Similarity=0.103 Sum_probs=58.7
Q ss_pred CCCCCceeEEEEeCc-chh--HHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccch
Q 007588 302 LHNPDLHHYAVFSDN-VLA--CAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLST 378 (597)
Q Consensus 302 l~d~~~ihIv~~sDn-~la--asVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~ 378 (597)
.+++..|.++=..-. ..+ +-.++.|+-+++. ...+++++. ++++.+. ++++
T Consensus 42 ~~~~k~IW~~W~QG~e~aP~~Vk~ci~s~~k~~~---~~~Vi~lt~----~Ni~~Yv-------------~~P~------ 95 (276)
T PF05704_consen 42 ETNEKIIWVCWWQGEENAPEIVKKCINSWRKNAP---DYEVILLTE----DNIKDYV-------------DIPD------ 95 (276)
T ss_pred CCCCCcEEEEECCCccccCHHHHHHHHHHHHHCC---CCeEEEECh----HHHHHHc-------------CCch------
Confidence 345555666654321 234 6779999999995 377888874 3343322 1121
Q ss_pred hhhhhhhccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccCcHHhhc
Q 007588 379 KYNATLKKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSDLGRLWN 433 (597)
Q Consensus 379 ~~~~vlk~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~DLseLw~ 433 (597)
+ +.+....+.-..--...++|+.|=.-.-. +|+|+++.+.++|.+.+.
T Consensus 96 -~--i~~k~~~g~i~~a~~SDilR~~LL~~yGG----vWiDatv~~t~~l~~~~~ 143 (276)
T PF05704_consen 96 -F--ILEKYEKGKISPAHFSDILRLALLYKYGG----VWIDATVYLTKPLDDEIF 143 (276)
T ss_pred -h--HHHHHHcCCCchhHHHHHHHHHHHHHcCc----EEeCCceEECCchhHHHh
Confidence 1 11111111112222357889987555554 899999999999998764
No 48
>PF04012 PspA_IM30: PspA/IM30 family; InterPro: IPR007157 This family includes PspA a protein that suppresses sigma54-dependent transcription. The PspA protein, a negative regulator of the Escherichia coli phage shock psp operon, is produced when virulence factors are exported through secretins in many Gram-negative pathogenic bacteria and its homologue in plants, VIPP1, plays a critical role in thylakoid biogenesis, essential for photosynthesis. Activation of transcription by the enhancer-dependent bacterial sigma54-containing RNA polymerase occurs through ATP hydrolysis-driven protein conformational changes enabled by activator proteins that belong to the large AAA(+) mechanochemical protein family. It has been shown that PspA directly and specifically acts upon and binds to the AAA(+) domain of the PspF transcription activator [].
Probab=42.06 E-value=88 Score=31.25 Aligned_cols=109 Identities=18% Similarity=0.254 Sum_probs=75.1
Q ss_pred cccCcHHHHHHhhHHHHHHHHHH--hhCCCCCCchHHHHHHHHHHHHHHhhccc--CCCCcccHHHHHHHHHHHHHHHHh
Q 007588 153 LLRVSDEKIKEMKDQVIRAQAYL--NFAPPGSNSHLVKELKLRIKEVERAVGAA--TKDSDLSRRAFRRMNQMEATLDKA 228 (597)
Q Consensus 153 ~~~~~d~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~el~~~~~e~~~~~~~~--~~~~~~~~~~~~~~~~m~~~~~~~ 228 (597)
|..+-|..|+.|.++|.-|+.=+ .+|....-.+-..++...+.+.+.-...| ..+.+|=..+.......+..+...
T Consensus 24 P~~~l~q~ird~e~~l~~a~~~~a~~~a~~~~le~~~~~~~~~~~~~~~~A~~Al~~g~edLAr~al~~k~~~e~~~~~l 103 (221)
T PF04012_consen 24 PEKMLEQAIRDMEEQLRKARQALARVMANQKRLERKLDEAEEEAEKWEKQAELALAAGREDLAREALQRKADLEEQAERL 103 (221)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHcCCHHHHHHHHHHHHHHHHHHHHH
Confidence 34667888999999998887733 33333333333345555555544433333 345567778888888888888888
Q ss_pred hcccCChHHHHHHHHHHHHHHHHHHHHHHhhhH
Q 007588 229 SHVYPDCSAMATKLRAMTYNAEERVRLQKNQAT 261 (597)
Q Consensus 229 ~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~ 261 (597)
+...-....-+.+|+.-+..++.++...+.+-.
T Consensus 104 ~~~~~~~~~~~~~l~~~l~~l~~kl~e~k~k~~ 136 (221)
T PF04012_consen 104 EQQLDQAEAQVEKLKEQLEELEAKLEELKSKRE 136 (221)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 888888888899999999999988887665443
No 49
>cd04190 Chitin_synth_C C-terminal domain of Chitin Synthase catalyzes the incorporation of GlcNAc from substrate UDP-GlcNAc into chitin. Chitin synthase, also called UDP-N-acetyl-D-glucosamine:chitin 4-beta-N-acetylglucosaminyltransferase, catalyzes the incorporation of GlcNAc from substrate UDP-GlcNAc into chitin, which is a linear homopolymer of GlcNAc residues formed by covalent beta-1,4 linkages. Chitin is an important component of the cell wall of fungi and bacteria and it is synthesized on the cytoplasmic surface of the cell membrane by membrane bound chitin synthases. Studies with fungi have revealed that most of them contain more than one chitin synthase gene. At least five subclasses of chitin synthases have been identified.
Probab=40.59 E-value=76 Score=31.80 Aligned_cols=24 Identities=25% Similarity=0.396 Sum_probs=19.9
Q ss_pred cCCCeEEEEecCeeeccC-cHHhhc
Q 007588 410 PALNKVLLFDHDVVVQSD-LGRLWN 433 (597)
Q Consensus 410 PeldKVLYLD~DvVVq~D-LseLw~ 433 (597)
...+-|+++|+|+++..| |..++.
T Consensus 72 a~~e~i~~~DaD~~~~~~~l~~l~~ 96 (244)
T cd04190 72 DDPEFILLVDADTKFDPDSIVQLYK 96 (244)
T ss_pred CCCCEEEEECCCCcCCHhHHHHHHH
Confidence 457999999999999888 566765
No 50
>cd04192 GT_2_like_e Subfamily of Glycosyltransferase Family GT2 of unknown function. GT-2 includes diverse families of glycosyltransferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. These are enzymes that catalyze the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. Glycosyltransferases have been classified into more than 90 distinct sequence based families.
Probab=39.75 E-value=2.1e+02 Score=27.18 Aligned_cols=36 Identities=14% Similarity=0.059 Sum_probs=23.7
Q ss_pred EeCcchhHHHHHHHHHhhcCCCCcEEEEEEeCCCCH
Q 007588 313 FSDNVLACAVVVNSTVSFAKEPEKIVFHVVTDSLNL 348 (597)
Q Consensus 313 ~sDn~laasVvI~Slv~Na~~p~~i~FHIvtd~is~ 348 (597)
+.+..-.+.-+|.|++.....+..+.+.|+.|+-+.
T Consensus 5 ~~n~~~~l~~~l~sl~~q~~~~~~~eiivvdd~s~d 40 (229)
T cd04192 5 ARNEAENLPRLLQSLSALDYPKEKFEVILVDDHSTD 40 (229)
T ss_pred ecCcHHHHHHHHHHHHhCCCCCCceEEEEEcCCCCc
Confidence 333333477889999887765445788888776543
No 51
>PRK10404 hypothetical protein; Provisional
Probab=37.52 E-value=1.6e+02 Score=26.43 Aligned_cols=78 Identities=14% Similarity=0.197 Sum_probs=56.2
Q ss_pred CCCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHH-HHHHHHHHHHHHHHHHHHHHhh
Q 007588 181 GSNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSA-MATKLRAMTYNAEERVRLQKNQ 259 (597)
Q Consensus 181 ~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~-~~~kl~~~~~~~e~~~~~~~~~ 259 (597)
.+.+++..||+.-+.++|.++.++..++ -+.+.+.=.+.+..|..+|....|... +..+.|++...+++-|+.+--|
T Consensus 5 ~~~~~l~~dl~~L~~dle~Ll~~~~~~a--~e~~~~lR~r~~~~L~~ar~~l~~~~~~~~~~~k~aa~~td~yV~e~Pw~ 82 (101)
T PRK10404 5 FGDTRIDDDLTLLSETLEEVLRSSGDPA--DQKYVELKARAEKALDDVKKRVSQASDSYYYRAKQAVYRADDYVHEKPWQ 82 (101)
T ss_pred chhhHHHHHHHHHHHHHHHHHHHhhhhh--HHHHHHHHHHHHHHHHHHHHHHHHhHHHHHHHHHHHHHHHHHHHHhCcHH
Confidence 4667888999999999999987776443 234445555567777777765555554 3456899999999999976655
Q ss_pred h
Q 007588 260 A 260 (597)
Q Consensus 260 ~ 260 (597)
+
T Consensus 83 a 83 (101)
T PRK10404 83 G 83 (101)
T ss_pred H
Confidence 4
No 52
>PRK11204 N-glycosyltransferase; Provisional
Probab=36.66 E-value=3.4e+02 Score=29.35 Aligned_cols=116 Identities=11% Similarity=0.051 Sum_probs=60.9
Q ss_pred CCCceeEEEEeCcch-hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhh
Q 007588 304 NPDLHHYAVFSDNVL-ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNA 382 (597)
Q Consensus 304 d~~~ihIv~~sDn~l-aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~ 382 (597)
+...+-|++.+-|.- .+.-++.|+....- | .+.+.|+.|+-+++........... ...++++..++
T Consensus 52 ~~p~vsViIp~yne~~~i~~~l~sl~~q~y-p-~~eiiVvdD~s~d~t~~~l~~~~~~-~~~v~~i~~~~---------- 118 (420)
T PRK11204 52 EYPGVSILVPCYNEGENVEETISHLLALRY-P-NYEVIAINDGSSDNTGEILDRLAAQ-IPRLRVIHLAE---------- 118 (420)
T ss_pred CCCCEEEEEecCCCHHHHHHHHHHHHhCCC-C-CeEEEEEECCCCccHHHHHHHHHHh-CCcEEEEEcCC----------
Confidence 334578888777643 46678888876543 3 5788888887665443332222111 11244443221
Q ss_pred hhhccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhccCCCCCEEEEec
Q 007588 383 TLKKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWNIDMKGKVIGAVD 445 (597)
Q Consensus 383 vlk~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~iDL~GkviAAV~ 445 (597)
+.. ...-...-+. ....|-++++|+|.++..| |..+.+.=..+.-+|+|.
T Consensus 119 --------n~G---ka~aln~g~~--~a~~d~i~~lDaD~~~~~d~L~~l~~~~~~~~~v~~v~ 169 (420)
T PRK11204 119 --------NQG---KANALNTGAA--AARSEYLVCIDGDALLDPDAAAYMVEHFLHNPRVGAVT 169 (420)
T ss_pred --------CCC---HHHHHHHHHH--HcCCCEEEEECCCCCCChhHHHHHHHHHHhCCCeEEEE
Confidence 000 1111111111 1347999999999999877 555554311233345553
No 53
>PRK10698 phage shock protein PspA; Provisional
Probab=35.80 E-value=1.3e+02 Score=30.74 Aligned_cols=108 Identities=12% Similarity=0.169 Sum_probs=71.7
Q ss_pred cccCcHHHHHHhhHHHHHHHHHH--hhCCCCCCchHHHHHHHHHHHHHHhhccc--CCCCcccHHHHHHHHHHHHHHHHh
Q 007588 153 LLRVSDEKIKEMKDQVIRAQAYL--NFAPPGSNSHLVKELKLRIKEVERAVGAA--TKDSDLSRRAFRRMNQMEATLDKA 228 (597)
Q Consensus 153 ~~~~~d~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~el~~~~~e~~~~~~~~--~~~~~~~~~~~~~~~~m~~~~~~~ 228 (597)
|..+-|..++.|+|++.=+|.=+ .+|....-.+-..++...+.+.++--.-| .++-+|-..++..-+.....+...
T Consensus 25 P~k~l~q~i~em~~~l~~~r~alA~~~A~~k~~er~~~~~~~~~~~~e~kA~~Al~~G~EdLAr~AL~~K~~~~~~~~~l 104 (222)
T PRK10698 25 PQKLVRLMIQEMEDTLVEVRSTSARALAEKKQLTRRIEQAEAQQVEWQEKAELALRKEKEDLARAALIEKQKLTDLIATL 104 (222)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHH
Confidence 34567889999999998777633 44444433444445555555543322222 335567777766666667777777
Q ss_pred hcccCChHHHHHHHHHHHHHHHHHHHHHHhhh
Q 007588 229 SHVYPDCSAMATKLRAMTYNAEERVRLQKNQA 260 (597)
Q Consensus 229 ~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~ 260 (597)
+...-.....+.+|+.-+..++.++..++.+-
T Consensus 105 ~~~~~~~~~~~~~L~~~l~~L~~ki~eak~k~ 136 (222)
T PRK10698 105 EHEVTLVDETLARMKKEIGELENKLSETRARQ 136 (222)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 77777888888999999999999888766443
No 54
>PF04765 DUF616: Protein of unknown function (DUF616); InterPro: IPR006852 The entry represents a protein of unknown function. The function of is unknown although a number of the members are thought to be glycosyltransferases.
Probab=32.79 E-value=1e+02 Score=33.14 Aligned_cols=93 Identities=14% Similarity=0.155 Sum_probs=58.0
Q ss_pred cEEEEEEeCCCCHHHHHHHHhhCCCCC---ceEEEEEccCCcccchhhhhhhhccCCCCCCCcchhhHHHhhhcccccCC
Q 007588 336 KIVFHVVTDSLNLPAISMWFLLNPPGK---ATIQIQSIDNFNWLSTKYNATLKKENSHDPRYTSALNHLRFYLPDVFPAL 412 (597)
Q Consensus 336 ~i~FHIvtd~is~e~~~~wf~l~~~~~---~~Ie~i~v~~f~~l~~~~~~vlk~l~s~~~~~~S~~~y~Rf~IPeLLPel 412 (597)
.++|.+++|..+...++.=-.. +..+ -..+++.++.....+ + ++. .-+.+++.-.+||++
T Consensus 91 ~vcf~mF~D~~t~~~l~~~~~~-~~~~~~ig~WrIv~v~~lp~~d----~-------rr~-----~r~~K~lpHrlfp~y 153 (305)
T PF04765_consen 91 NVCFFMFVDEETLKSLESEGHI-PDENKKIGIWRIVVVKNLPYDD----P-------RRN-----GRIPKLLPHRLFPNY 153 (305)
T ss_pred CccEEEEEehhhHHHHHhcCCc-cccccccCceEEEEecCCCCcc----h-------hhc-----CcccceeccccCCCC
Confidence 6899999999887766431111 1111 134555554321111 0 111 123467777899999
Q ss_pred CeEEEEecCeeeccCcHHhhccCC--CCCEEEEec
Q 007588 413 NKVLLFDHDVVVQSDLGRLWNIDM--KGKVIGAVD 445 (597)
Q Consensus 413 dKVLYLD~DvVVq~DLseLw~iDL--~GkviAAV~ 445 (597)
+--||+|+-+.+.+|...|.+-=+ ++..+|+..
T Consensus 154 ~ySIWID~ki~L~~Dp~~lie~~l~~~~~~~Ai~~ 188 (305)
T PF04765_consen 154 DYSIWIDGKIQLIVDPLLLIERFLWRKNADIAISK 188 (305)
T ss_pred ceEEEEeeeEEEecCHHHHHHHHHhcCCCcEEEeC
Confidence 999999999999999988776433 456676654
No 55
>cd04196 GT_2_like_d Subfamily of Glycosyltransferase Family GT2 of unknown function. GT-2 includes diverse families of glycosyltransferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. These are enzymes that catalyze the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. Glycosyltransferases have been classified into more than 90 distinct sequence based families.
Probab=30.54 E-value=3.3e+02 Score=25.55 Aligned_cols=99 Identities=12% Similarity=0.034 Sum_probs=50.9
Q ss_pred EEEeCc-chhHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHhhCCCCCceEEEEEccCCcccchhhhhhhhccCC
Q 007588 311 AVFSDN-VLACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFLLNPPGKATIQIQSIDNFNWLSTKYNATLKKENS 389 (597)
Q Consensus 311 v~~sDn-~laasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~l~s 389 (597)
++.+=| .-.+.-+|.|++..... .+.+.|+.|+-+..............+..+.++.-+.
T Consensus 3 vIp~yn~~~~l~~~l~sl~~q~~~--~~eiiVvddgS~d~t~~~~~~~~~~~~~~~~~~~~~~----------------- 63 (214)
T cd04196 3 LMATYNGEKYLREQLDSILAQTYK--NDELIISDDGSTDGTVEIIKEYIDKDPFIIILIRNGK----------------- 63 (214)
T ss_pred EEEecCcHHHHHHHHHHHHhCcCC--CeEEEEEeCCCCCCcHHHHHHHHhcCCceEEEEeCCC-----------------
Confidence 344444 33467888999886543 5888888776654332222221111112232222211
Q ss_pred CCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhcc
Q 007588 390 HDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWNI 434 (597)
Q Consensus 390 ~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~i 434 (597)
+.......+.. + ....-+-|++||+|.+...+ |..+++.
T Consensus 64 -~~G~~~~~n~g-~----~~~~g~~v~~ld~Dd~~~~~~l~~~~~~ 103 (214)
T cd04196 64 -NLGVARNFESL-L----QAADGDYVFFCDQDDIWLPDKLERLLKA 103 (214)
T ss_pred -CccHHHHHHHH-H----HhCCCCEEEEECCCcccChhHHHHHHHH
Confidence 11111111111 1 12357999999988777755 8888876
No 56
>COG0836 {ManC} Mannose-1-phosphate guanylyltransferase [Cell envelope biogenesis, outer membrane]
Probab=30.47 E-value=28 Score=37.53 Aligned_cols=24 Identities=21% Similarity=0.369 Sum_probs=18.4
Q ss_pred ccCCCCCceecceEEeecHHHHHh
Q 007588 471 KFDVKACTWAFGMNLFDLQEWRKR 494 (597)
Q Consensus 471 ~fd~~~~yFNSGVmLiNL~kWR~~ 494 (597)
++..+.+||||||.+|.-..+.++
T Consensus 186 yv~sG~y~WNSGmF~Fra~~~l~e 209 (333)
T COG0836 186 YVESGEYLWNSGMFLFRASVFLEE 209 (333)
T ss_pred HHHcCceEeeccceEEEHHHHHHH
Confidence 345677999999999987666543
No 57
>PF05957 DUF883: Bacterial protein of unknown function (DUF883); InterPro: IPR010279 This family consists of several bacterial proteins of unknown function that include the Escherichia coli genes for ElaB, YgaM and YqjD.
Probab=30.35 E-value=2e+02 Score=24.94 Aligned_cols=75 Identities=21% Similarity=0.198 Sum_probs=47.2
Q ss_pred hHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChH-HHHHHHHHHHHHHHHHHHHHHhhhH
Q 007588 185 HLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCS-AMATKLRAMTYNAEERVRLQKNQAT 261 (597)
Q Consensus 185 ~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~-~~~~kl~~~~~~~e~~~~~~~~~~~ 261 (597)
.+..||.+-+.+++.++..+...+ ...+.+.-..++..+..+++..-|.. .+..+.+.....+|+.++.+--++.
T Consensus 2 ~l~~~l~~l~~d~~~l~~~~~~~~--~~~~~~~r~~~~~~~~~a~~~~~~~~~~~~~~~~~~~~~~~~~V~e~P~~sv 77 (94)
T PF05957_consen 2 DLKAELEQLRADLEDLARSAADLA--GEKADEARDRAEEALDDARDRAEDAADQAREQAREAAEQTEDYVRENPWQSV 77 (94)
T ss_pred hHHHHHHHHHHHHHHHHHHHHHhH--HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHChHHHH
Confidence 455677777777777666554322 22334444444555555555444433 4678889999999999998877764
No 58
>PLN02867 Probable galacturonosyltransferase
Probab=29.01 E-value=1.7e+02 Score=33.81 Aligned_cols=76 Identities=13% Similarity=0.083 Sum_probs=58.6
Q ss_pred CCCchHHHHHHHHHHHHHHhhcccCCCC--cccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHHHHHh
Q 007588 181 GSNSHLVKELKLRIKEVERAVGAATKDS--DLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVRLQKN 258 (597)
Q Consensus 181 ~~~~~~~~el~~~~~e~~~~~~~~~~~~--~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~ 258 (597)
....++++|+.+.+.|... .+..... +.|+++++.+.+|...-..++....-.++|..++...+.+.-.|..+...
T Consensus 89 ~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~kl~am~~~~e~~~~~~~~~~~~~~~ 166 (535)
T PLN02867 89 DTSLKLREELTRALVEAKE--QDDGGRGTKGSTESFNDLVKEMTSNRQDIKAFAFRTKAMLLKMERKVQSARQRESIYWH 166 (535)
T ss_pred CchhHHHHHHHHHHHHhhh--ccccCcchhhhhhHHHHHHHHHHhccchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 3456899999999998643 2323333 68999999999999988888888888889988888888877777665544
No 59
>cd04185 GT_2_like_b Subfamily of Glycosyltransferase Family GT2 of unknown function. GT-2 includes diverse families of glycosyltransferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. These are enzymes that catalyze the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. Glycosyltransferases have been classified into more than 90 distinct sequence based families.
Probab=27.50 E-value=4.9e+02 Score=24.43 Aligned_cols=23 Identities=22% Similarity=0.409 Sum_probs=17.4
Q ss_pred CCCeEEEEecCeeeccCc-HHhhc
Q 007588 411 ALNKVLLFDHDVVVQSDL-GRLWN 433 (597)
Q Consensus 411 eldKVLYLD~DvVVq~DL-seLw~ 433 (597)
..+-++++|+|.++..+. ..|.+
T Consensus 79 ~~d~v~~ld~D~~~~~~~l~~l~~ 102 (202)
T cd04185 79 GYDWIWLMDDDAIPDPDALEKLLA 102 (202)
T ss_pred CCCEEEEeCCCCCcChHHHHHHHH
Confidence 579999999999997553 34444
No 60
>COG1842 PspA Phage shock protein A (IM30), suppresses sigma54-dependent transcription [Transcription / Signal transduction mechanisms]
Probab=27.31 E-value=1.7e+02 Score=29.95 Aligned_cols=106 Identities=16% Similarity=0.253 Sum_probs=55.6
Q ss_pred ccCcHHHHHHhhHHHHHHHHHH--hhCCCCCCchHHHHHHHHHHHHHHhhccc--CCCCcccHHHHHHHHHHHHHHHHhh
Q 007588 154 LRVSDEKIKEMKDQVIRAQAYL--NFAPPGSNSHLVKELKLRIKEVERAVGAA--TKDSDLSRRAFRRMNQMEATLDKAS 229 (597)
Q Consensus 154 ~~~~d~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~el~~~~~e~~~~~~~~--~~~~~~~~~~~~~~~~m~~~~~~~~ 229 (597)
..+-|..|+.|+++|.-|+-=+ .||..+.-.+=+.++..+..+.+.=.-.| ..+.+|-..+...+...+..+..-+
T Consensus 26 ~~~l~Q~ird~~~~l~~ar~~~A~~~a~~k~~e~~~~~~~~~~~k~e~~A~~Al~~g~E~LAr~al~~~~~le~~~~~~~ 105 (225)
T COG1842 26 EKMLEQAIRDMESELAKARQALAQAIARQKQLERKLEEAQARAEKLEEKAELALQAGNEDLAREALEEKQSLEDLAKALE 105 (225)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHH
Confidence 3556677777777776665433 22221111111123333333332211111 2234455666666666666666666
Q ss_pred cccCChHHHHHHHHHHHHHHHHHHHHHHhh
Q 007588 230 HVYPDCSAMATKLRAMTYNAEERVRLQKNQ 259 (597)
Q Consensus 230 ~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~ 259 (597)
...........+||..+..+|.++...+.+
T Consensus 106 ~~~~~~~~~~~~l~~~~~~Le~Ki~e~~~~ 135 (225)
T COG1842 106 AELQQAEEQVEKLKKQLAALEQKIAELRAK 135 (225)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 666666667777777777777776654433
No 61
>PF03314 DUF273: Protein of unknown function, DUF273; InterPro: IPR004988 This is a family of proteins of unknown function.
Probab=25.71 E-value=42 Score=34.23 Aligned_cols=24 Identities=25% Similarity=0.484 Sum_probs=20.2
Q ss_pred hhcccccCCCeEEEEecCeeeccC
Q 007588 404 YLPDVFPALNKVLLFDHDVVVQSD 427 (597)
Q Consensus 404 ~IPeLLPeldKVLYLD~DvVVq~D 427 (597)
.+..+||+++-||+||+||-|...
T Consensus 34 vva~~L~~~~~vlflDaDigVvNp 57 (222)
T PF03314_consen 34 VVAKILPEYDWVLFLDADIGVVNP 57 (222)
T ss_pred HHHHHhccCCEEEEEcCCceeecC
Confidence 357789999999999999988643
No 62
>TIGR03469 HonB hopene-associated glycosyltransferase HpnB. This family of genes include a glycosyl transferase, group 2 domain (pfam00535) which are responsible, generally for the transfer of nucleotide-diphosphate sugars to substrates such as polysaccharides and lipids. The genes of this family are often found in the same genetic locus with squalene-hopene cyclase genes, and are never associated with genes for the metabolism of phytoene. Indeed, the members of this family appear to never be found in a genome lacking squalene-hopene cyclase (SHC), although not all genomes encoding SHC have this glycosyl transferase. In the organism Zymomonas mobilis the linkage of this gene to hopanoid biosynthesis has been noted and the gene named HpnB. Hopanoids are known to feature polar glycosyl head groups in many organisms.
Probab=24.90 E-value=8e+02 Score=26.51 Aligned_cols=112 Identities=17% Similarity=0.091 Sum_probs=57.8
Q ss_pred CceeEEEEeCcch-hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHH---HHHHHhhCCCCCceEEEEEccCCcccchhhh
Q 007588 306 DLHHYAVFSDNVL-ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPA---ISMWFLLNPPGKATIQIQSIDNFNWLSTKYN 381 (597)
Q Consensus 306 ~~ihIv~~sDn~l-aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~---~~~wf~l~~~~~~~Ie~i~v~~f~~l~~~~~ 381 (597)
..+-|++.+-|.- .+.-++.|+....- |..+.+.|+.|+-++.. ++.+....+ ....++++..+. .+.++
T Consensus 40 p~VSVIIpa~Ne~~~L~~~L~sL~~q~y-p~~~eIIVVDd~StD~T~~i~~~~~~~~~-~~~~i~vi~~~~---~~~g~- 113 (384)
T TIGR03469 40 PAVVAVVPARNEADVIGECVTSLLEQDY-PGKLHVILVDDHSTDGTADIARAAARAYG-RGDRLTVVSGQP---LPPGW- 113 (384)
T ss_pred CCEEEEEecCCcHhHHHHHHHHHHhCCC-CCceEEEEEeCCCCCcHHHHHHHHHHhcC-CCCcEEEecCCC---CCCCC-
Confidence 3477777777743 47788999987543 23477888877655433 333322111 112455554321 01010
Q ss_pred hhhhccCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeeccC-cHHhhc
Q 007588 382 ATLKKENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQSD-LGRLWN 433 (597)
Q Consensus 382 ~vlk~l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq~D-LseLw~ 433 (597)
..+......-++. ..+..++.|-++++|+|+++..| |..+..
T Consensus 114 ---------~Gk~~A~n~g~~~-A~~~~~~gd~llflDaD~~~~p~~l~~lv~ 156 (384)
T TIGR03469 114 ---------SGKLWAVSQGIAA-ARTLAPPADYLLLTDADIAHGPDNLARLVA 156 (384)
T ss_pred ---------cchHHHHHHHHHH-HhccCCCCCEEEEECCCCCCChhHHHHHHH
Confidence 0000011011111 12233447899999999998654 466654
No 63
>PF11464 Rbsn: Rabenosyn Rab binding domain; InterPro: IPR021565 Rabenosyn-5 (Rbsn) is a multivalent effector with interacts with the Rab family.Rsbn contains distinct Rab4 and Rab5 binding sites within residues 264-500 and 627-784 respectively []. Rab proteins are GTPases involved in the regulation of all stages of membrane trafficking []. ; PDB: 1Z0K_B 1YZM_A 1Z0J_B.
Probab=23.93 E-value=1e+02 Score=23.62 Aligned_cols=36 Identities=17% Similarity=0.255 Sum_probs=30.9
Q ss_pred hHHHHHHHHHHhhCCCCCCchHHHHHHHHHHHHHHh
Q 007588 165 KDQVIRAQAYLNFAPPGSNSHLVKELKLRIKEVERA 200 (597)
Q Consensus 165 ~dq~~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~ 200 (597)
-.|+..-++|..=||..+.-.=+.=|..|++|+++-
T Consensus 2 leQi~~I~~~I~qAk~~~r~dEV~~L~~NL~EL~~e 37 (42)
T PF11464_consen 2 LEQINIIESYIKQAKAARRFDEVATLEENLRELQDE 37 (42)
T ss_dssp HHHHHHHHHHHHHHHHTT-HHHHHHHHHHHHHHHHH
T ss_pred HHHHHHHHHHHHHHHHhcCcHHHHHHHHHHHHHHHH
Confidence 479999999998899999988888999999999764
No 64
>TIGR03111 glyc2_xrt_Gpos1 putative glycosyltransferase TIGR03111. Members of this protein family probable glycosyltransferases of family 2, whose genes are near those for Gram-positive proteins (TIGR03110) related to the proposed exosortase (TIGR02602).
Probab=22.76 E-value=7.3e+02 Score=27.47 Aligned_cols=48 Identities=8% Similarity=-0.139 Sum_probs=33.3
Q ss_pred CCceeEEEEeCcch-hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHH
Q 007588 305 PDLHHYAVFSDNVL-ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAIS 352 (597)
Q Consensus 305 ~~~ihIv~~sDn~l-aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~ 352 (597)
...+-|++.+-|.- .+.-+|.|+....-++..+.+.|+.|+-+++..+
T Consensus 48 ~P~vsVIIP~yNe~~~l~~~l~sl~~q~yp~~~~eIiVVDd~StD~T~~ 96 (439)
T TIGR03111 48 LPDITIIIPVYNSEDTLFNCIESIYNQTYPIELIDIILANNQSTDDSFQ 96 (439)
T ss_pred CCCEEEEEEeCCChHHHHHHHHHHHhcCCCCCCeEEEEEECCCChhHHH
Confidence 34588888887753 4777899988766554567788887776655443
No 65
>cd02510 pp-GalNAc-T pp-GalNAc-T initiates the formation of mucin-type O-linked glycans. UDP-GalNAc: polypeptide alpha-N-acetylgalactosaminyltransferases (pp-GalNAc-T) initiate the formation of mucin-type, O-linked glycans by catalyzing the transfer of alpha-N-acetylgalactosamine (GalNAc) from UDP-GalNAc to hydroxyl groups of Ser or Thr residues of core proteins to form the Tn antigen (GalNAc-a-1-O-Ser/Thr). These enzymes are type II membrane proteins with a GT-A type catalytic domain and a lectin domain located on the lumen side of the Golgi apparatus. In human, there are 15 isozymes of pp-GalNAc-Ts, representing the largest of all glycosyltransferase families. Each isozyme has unique but partially redundant substrate specificity for glycosylation sites on acceptor proteins.
Probab=21.84 E-value=6.1e+02 Score=25.98 Aligned_cols=101 Identities=11% Similarity=0.029 Sum_probs=51.5
Q ss_pred EEEEeCcch--hHHHHHHHHHhhcCCCCcEEEEEEeCCCCHHHHHHHHh-hCCCCCceEEEEEccCCcccchhhhhhhhc
Q 007588 310 YAVFSDNVL--ACAVVVNSTVSFAKEPEKIVFHVVTDSLNLPAISMWFL-LNPPGKATIQIQSIDNFNWLSTKYNATLKK 386 (597)
Q Consensus 310 Iv~~sDn~l--aasVvI~Slv~Na~~p~~i~FHIvtd~is~e~~~~wf~-l~~~~~~~Ie~i~v~~f~~l~~~~~~vlk~ 386 (597)
|++.+-|.- .+.-+|.|++.+...+..+.+-||.|+-+......+.. ........+.++..+. +.++.
T Consensus 2 IIIp~~N~~~~~l~~~l~Sl~~~~~~~~~~EIIvVDd~S~d~t~~~~~~~~~~~~~~~v~vi~~~~----n~G~~----- 72 (299)
T cd02510 2 VIIIFHNEALSTLLRTVHSVINRTPPELLKEIILVDDFSDKPELKLLLEEYYKKYLPKVKVLRLKK----REGLI----- 72 (299)
T ss_pred EEEEEecCcHHHHHHHHHHHHhcCchhcCCEEEEEECCCCchHHHHHHHHHHhhcCCcEEEEEcCC----CCCHH-----
Confidence 445555533 47778999998765432346677777665554443322 0011112344443332 00110
Q ss_pred cCCCCCCCcchhhHHHhhhcccccCCCeEEEEecCeeec-cCcHHhhc
Q 007588 387 ENSHDPRYTSALNHLRFYLPDVFPALNKVLLFDHDVVVQ-SDLGRLWN 433 (597)
Q Consensus 387 l~s~~~~~~S~~~y~Rf~IPeLLPeldKVLYLD~DvVVq-~DLseLw~ 433 (597)
...| .-+.. -.-+-|++||+|+++. +-|..|.+
T Consensus 73 ---------~a~N---~g~~~--A~gd~i~fLD~D~~~~~~wL~~ll~ 106 (299)
T cd02510 73 ---------RARI---AGARA--ATGDVLVFLDSHCEVNVGWLEPLLA 106 (299)
T ss_pred ---------HHHH---HHHHH--ccCCEEEEEeCCcccCccHHHHHHH
Confidence 0111 11111 1358999999999996 44566665
No 66
>PF06103 DUF948: Bacterial protein of unknown function (DUF948); InterPro: IPR009293 This family consists of bacterial sequences several of which are thought to be general stress proteins.
Probab=21.68 E-value=5.1e+02 Score=22.08 Aligned_cols=61 Identities=15% Similarity=0.221 Sum_probs=41.0
Q ss_pred HHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHHHHHHHH
Q 007588 188 KELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYNAEERVR 254 (597)
Q Consensus 188 ~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~ 254 (597)
+.+++-++++++.+.. +.+.+.+..+++..++.+++...-|...-..++..+..+.++--.
T Consensus 22 ~~l~~~l~~~~~ti~~------l~~~~~~i~~e~~~ll~~~n~l~~dv~~k~~~v~~~~~~v~~~g~ 82 (90)
T PF06103_consen 22 KKLKKTLDEVNKTIDT------LQEQVDPITKEINDLLHNTNELLEDVNEKLEKVDPVFEAVADLGE 82 (90)
T ss_pred HHHHHHHHHHHHHHHH------HHHhHHHHHHHHHHHHHHHHHHHHHHHHHHHhHHHHHHHHHHHHH
Confidence 3445555555444432 334567777888888888888888888887888777777765433
No 67
>PF10146 zf-C4H2: Zinc finger-containing protein ; InterPro: IPR018482 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. This entry represents a family of proteins which appears to have a highly conserved zinc finger domain at the C-terminal end, described as -C-X2-CH-X3-H-X5-C-X2-C-. The structure is predicted to contain a coiled coil. Members of this family are annotated as being tumour-associated antigen HCA127 in humans, but this could not be confirmed.
Probab=20.77 E-value=4.8e+02 Score=26.91 Aligned_cols=88 Identities=8% Similarity=0.132 Sum_probs=61.2
Q ss_pred HHHHHHHhhCCCCCCchHHHHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHHHHHHHHHHHH
Q 007588 169 IRAQAYLNFAPPGSNSHLVKELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAMATKLRAMTYN 248 (597)
Q Consensus 169 ~~a~~y~~~a~~~~~~~~~~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~~~kl~~~~~~ 248 (597)
..++.+-.++...+..++..|++..+.++.. |-..-.+--..+++=+..||.+|..+++..-.....+.++..-+..
T Consensus 16 ~k~~i~~e~~~~e~ee~~L~e~~kE~~~L~~---Er~~h~eeLrqI~~DIn~lE~iIkqa~~er~~~~~~i~r~~eey~~ 92 (230)
T PF10146_consen 16 LKNEILQEVESLENEEKCLEEYRKEMEELLQ---ERMAHVEELRQINQDINTLENIIKQAESERNKRQEKIQRLYEEYKP 92 (230)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH---HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 3444455666667778888888887777611 1111111123557778889999999999888888888888888888
Q ss_pred HHHHHHHHHhh
Q 007588 249 AEERVRLQKNQ 259 (597)
Q Consensus 249 ~e~~~~~~~~~ 259 (597)
+-+++...++.
T Consensus 93 Lk~~in~~R~e 103 (230)
T PF10146_consen 93 LKDEINELRKE 103 (230)
T ss_pred HHHHHHHHHHH
Confidence 88888876554
No 68
>PF10073 DUF2312: Uncharacterized protein conserved in bacteria (DUF2312); InterPro: IPR018753 This entry is represented by Azospirillum phage Cd, Gp10. The characteristics of the protein distribution suggest prophage matches in addition to the phage matches. Members of this family of hypothetical bacterial proteins have no known function.
Probab=20.08 E-value=3.4e+02 Score=23.33 Aligned_cols=48 Identities=21% Similarity=0.244 Sum_probs=34.6
Q ss_pred HHHHHHHHHHHHhhcccCCCCcccHHHHHHHHHHHHHHHHhhcccCChHHH--HHHHHHH
Q 007588 188 KELKLRIKEVERAVGAATKDSDLSRRAFRRMNQMEATLDKASHVYPDCSAM--ATKLRAM 245 (597)
Q Consensus 188 ~el~~~~~e~~~~~~~~~~~~~~~~~~~~~~~~m~~~~~~~~~~~~~~~~~--~~kl~~~ 245 (597)
.+|++-|..+|| |-.+-......+..+-+.||...+|-+.+ +-+||.+
T Consensus 4 ~~Lr~~ieRiEr----------LEeEk~~i~~dikdVyaEAK~~GfD~K~lr~ii~lRk~ 53 (74)
T PF10073_consen 4 EQLRQFIERIER----------LEEEKKAISDDIKDVYAEAKGNGFDTKALRQIIRLRKK 53 (74)
T ss_pred HHHHHHHHHHHH----------HHHHHHHHHHHHHHHHHHHHhCCCCHHHHHHHHHHHcC
Confidence 467888877777 33344556677788899999999999988 3444443
Done!