Query 009572
Match_columns 532
No_of_seqs 321 out of 1368
Neff 6.0
Searched_HMMs 46136
Date Thu Mar 28 14:44:41 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/009572.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/009572hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PLN02742 Probable galacturonos 100.0 8E-150 2E-154 1192.7 42.6 531 1-532 1-534 (534)
2 PLN02829 Probable galacturonos 100.0 3E-132 8E-137 1067.0 36.7 481 47-532 156-638 (639)
3 PLN02910 polygalacturonate 4-a 100.0 2E-129 4E-134 1044.2 35.1 462 66-532 190-656 (657)
4 PLN02769 Probable galacturonos 100.0 3E-121 7E-126 988.0 35.3 451 67-532 175-629 (629)
5 PLN02718 Probable galacturonos 100.0 6E-118 1E-122 959.3 35.9 443 64-532 156-602 (603)
6 PLN02523 galacturonosyltransfe 100.0 2E-111 5E-116 898.7 41.8 462 69-532 78-558 (559)
7 PLN02870 Probable galacturonos 100.0 8E-109 2E-113 877.0 28.1 423 99-532 90-531 (533)
8 PLN02867 Probable galacturonos 100.0 2E-108 5E-113 877.0 28.9 422 106-532 93-534 (535)
9 PLN02659 Probable galacturonos 100.0 5E-108 1E-112 871.2 27.8 421 109-532 93-532 (534)
10 cd06429 GT8_like_1 GT8_like_1 100.0 3.6E-56 7.9E-61 447.3 21.9 254 227-520 1-257 (257)
11 PRK15171 lipopolysaccharide 1, 100.0 6.2E-45 1.3E-49 378.8 21.3 262 224-527 23-293 (334)
12 cd06431 GT8_LARGE_C LARGE cata 100.0 1.8E-41 3.9E-46 344.9 19.7 260 229-528 5-277 (280)
13 cd00505 Glyco_transf_8 Members 100.0 1.7E-39 3.6E-44 323.5 19.6 237 227-505 1-246 (246)
14 cd04194 GT8_A4GalT_like A4GalT 100.0 6.2E-39 1.3E-43 318.8 18.3 237 227-505 1-248 (248)
15 COG1442 RfaJ Lipopolysaccharid 100.0 2.5E-37 5.5E-42 318.7 20.8 257 226-527 2-268 (325)
16 PF01501 Glyco_transf_8: Glyco 100.0 1.6E-35 3.6E-40 289.2 15.5 244 228-506 1-249 (250)
17 cd06432 GT8_HUGT1_C_like The C 100.0 2.8E-32 6.1E-37 273.1 16.2 233 228-499 2-240 (248)
18 cd06430 GT8_like_2 GT8_like_2 100.0 1.1E-31 2.3E-36 274.3 19.7 249 227-522 1-276 (304)
19 cd02537 GT8_Glycogenin Glycoge 99.9 4.8E-25 1E-29 219.5 17.1 216 231-519 6-237 (240)
20 PLN00176 galactinol synthase 99.9 2.6E-23 5.7E-28 215.5 18.5 233 236-521 36-293 (333)
21 cd06914 GT8_GNT1 GNT1 is a fun 99.7 8E-18 1.7E-22 171.1 9.9 140 334-507 76-242 (278)
22 KOG1879 UDP-glucose:glycoprote 99.3 7.6E-12 1.7E-16 143.8 7.9 255 222-518 1177-1442(1470)
23 COG5597 Alpha-N-acetylglucosam 97.4 0.0001 2.2E-09 75.6 3.6 94 339-435 156-278 (368)
24 PLN03182 xyloglucan 6-xylosylt 93.4 0.31 6.8E-06 52.5 8.6 160 332-516 179-375 (429)
25 PF03407 Nucleotid_trans: Nucl 93.2 0.18 3.9E-06 48.9 6.0 141 334-499 47-202 (212)
26 PF11051 Mannosyl_trans3: Mann 81.4 4.5 9.8E-05 41.4 7.2 32 344-375 83-114 (271)
27 PLN03181 glycosyltransferase; 78.1 3.5 7.7E-05 44.8 5.2 35 332-367 180-214 (453)
28 PF10819 DUF2564: Protein of u 70.5 21 0.00046 30.1 6.8 71 102-173 6-78 (79)
29 PF05637 Glyco_transf_34: gala 70.3 2.8 6.2E-05 42.2 2.2 24 349-372 74-97 (239)
30 PF03071 GNT-I: GNT-I family; 69.7 10 0.00023 41.6 6.4 115 229-374 98-214 (434)
31 COG4575 ElaB Uncharacterized c 68.3 24 0.00053 31.2 7.2 75 98-176 11-86 (104)
32 KOG1928 Alpha-1,4-N-acetylgluc 63.8 3.4 7.4E-05 44.4 1.3 32 338-373 228-259 (409)
33 PRK10132 hypothetical protein; 63.4 32 0.0007 30.7 7.2 75 98-176 15-89 (108)
34 cd02514 GT13_GLCNAC-TI GT13_GL 62.1 28 0.00062 37.0 7.8 113 229-373 5-119 (334)
35 PRK05529 cell division protein 57.8 7.6 0.00016 39.5 2.5 12 360-371 213-224 (255)
36 PF04488 Gly_transf_sug: Glyco 56.8 8.8 0.00019 33.1 2.5 35 334-372 62-97 (103)
37 KOG1950 Glycosyl transferase, 55.2 21 0.00045 38.2 5.5 148 349-505 122-288 (369)
38 cd00761 Glyco_tranf_GTA_type G 50.8 1.2E+02 0.0027 25.4 8.8 41 232-274 5-45 (156)
39 PF06637 PV-1: PV-1 protein (P 50.6 2.8E+02 0.006 30.2 12.6 17 25-41 35-51 (442)
40 PRK10404 hypothetical protein; 44.7 1.1E+02 0.0025 26.8 7.5 78 94-175 4-82 (101)
41 PF11464 Rbsn: Rabenosyn Rab b 44.2 86 0.0019 23.4 5.5 38 79-116 2-39 (42)
42 PRK09039 hypothetical protein; 43.7 58 0.0013 34.7 6.6 29 9-37 6-36 (343)
43 PF10073 DUF2312: Uncharacteri 41.1 1.2E+02 0.0025 25.5 6.5 45 102-158 4-48 (74)
44 PF10112 Halogen_Hydrol: 5-bro 41.0 1.5E+02 0.0033 28.7 8.6 14 76-89 71-84 (199)
45 PLN02742 Probable galacturonos 37.9 3.2E+02 0.007 31.1 11.3 138 8-166 2-143 (534)
46 COG4068 Uncharacterized protei 36.7 15 0.00033 29.2 0.7 18 20-37 45-62 (64)
47 PRK10788 periplasmic folding c 35.5 4.9E+02 0.011 29.7 12.9 26 13-39 6-31 (623)
48 PF12273 RCR: Chitin synthesis 35.1 19 0.00041 32.7 1.2 20 19-38 2-21 (130)
49 PF05478 Prominin: Prominin; 34.9 1.2E+02 0.0026 36.1 8.0 49 130-178 237-285 (806)
50 PRK04778 septation ring format 33.5 1.7E+02 0.0037 33.3 8.6 127 19-182 4-145 (569)
51 PF03314 DUF273: Protein of un 32.6 30 0.00066 34.5 2.2 24 344-367 34-57 (222)
52 PF11932 DUF3450: Protein of u 32.5 93 0.002 31.3 5.8 137 63-207 46-200 (251)
53 PRK13694 hypothetical protein; 32.3 1.9E+02 0.0041 24.7 6.5 45 101-157 11-55 (83)
54 PF13624 SurA_N_3: SurA N-term 31.9 1.7E+02 0.0036 26.6 6.9 73 99-175 74-146 (154)
55 PF10828 DUF2570: Protein of u 31.5 2.2E+02 0.0047 25.2 7.3 68 68-137 41-108 (110)
56 PF12273 RCR: Chitin synthesis 29.2 34 0.00075 31.0 1.8 21 22-42 2-22 (130)
57 TIGR02977 phageshock_pspA phag 29.1 3.3E+02 0.007 26.9 8.9 106 70-175 28-135 (219)
58 PF15290 Syntaphilin: Golgi-lo 29.0 1E+02 0.0022 32.1 5.2 92 70-167 65-170 (305)
59 PHA00407 phage lambda Rz1-like 28.3 45 0.00098 28.0 2.1 63 6-71 18-81 (84)
60 PF05546 She9_MDM33: She9 / Md 28.3 48 0.001 32.9 2.7 27 13-39 147-173 (207)
61 PRK12302 bssR biofilm formatio 27.1 40 0.00087 30.0 1.7 25 132-156 70-98 (127)
62 PF05957 DUF883: Bacterial pro 25.3 2.8E+02 0.0061 23.5 6.7 74 99-176 2-76 (94)
63 PF11286 DUF3087: Protein of u 25.2 4.5E+02 0.0098 25.3 8.5 37 70-117 62-98 (165)
64 PF04012 PspA_IM30: PspA/IM30 24.8 4.3E+02 0.0094 25.8 8.9 106 70-175 27-134 (221)
65 cd06423 CESA_like CESA_like is 24.4 3.8E+02 0.0082 23.0 7.7 33 236-270 9-41 (180)
66 cd04186 GT_2_like_c Subfamily 23.2 5E+02 0.011 22.5 8.4 34 236-271 9-42 (166)
67 COG2332 CcmE Cytochrome c-type 23.1 71 0.0015 30.2 2.7 20 23-42 15-34 (153)
68 PRK15384 type III secretion sy 22.8 39 0.00084 34.5 1.0 22 353-374 217-238 (336)
69 PF10799 YliH: Biofilm formati 22.8 1.7E+02 0.0037 26.5 4.8 90 70-166 2-112 (127)
70 PHA02692 hypothetical protein; 22.7 1E+02 0.0022 25.5 3.1 28 12-39 38-65 (70)
71 COG3750 Uncharacterized protei 22.7 3.7E+02 0.0079 22.9 6.4 46 102-159 14-59 (85)
72 PRK15383 type III secretion sy 22.5 41 0.00089 34.3 1.1 22 353-374 220-241 (335)
73 PRK15382 non-LEE encoded effec 22.3 42 0.00091 34.2 1.1 22 353-374 212-233 (326)
74 PF00220 Hormone_4: Neurohypop 20.9 44 0.00095 17.1 0.5 8 525-532 2-9 (9)
75 PF02532 PsbI: Photosystem II 20.8 1.6E+02 0.0035 21.3 3.4 27 21-47 6-32 (36)
76 PRK10807 paraquat-inducible pr 20.4 2.4E+02 0.0052 32.1 6.7 16 128-143 476-491 (547)
77 PF10146 zf-C4H2: Zinc finger- 20.1 4.9E+02 0.011 26.3 8.1 84 87-175 20-103 (230)
No 1
>PLN02742 Probable galacturonosyltransferase
Probab=100.00 E-value=8.4e-150 Score=1192.71 Aligned_cols=531 Identities=73% Similarity=1.223 Sum_probs=511.9
Q ss_pred CCCCCccCccccccccchhHHHHHHHHHHHHHHHHhhhcccc-cCCCCCCCCccchhhhc-cCCCccccccChhhHHHHh
Q 009572 1 MRRRGQDFRRPVRRRISHVVWWTLCGIAVLLFIVILSKESQI-ESRPTFPKRYDRRDRIM-EGLNITDEMLSANSVTRQL 78 (532)
Q Consensus 1 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~ 78 (532)
||||++|+|||+|||+++| ||+++|+|+++|+++|+-.+++ +++||+++++.+.+++. +|+|+|||++++|+++|+|
T Consensus 1 ~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l 79 (534)
T PLN02742 1 MRRRPADFRRPVRRRLSQW-IWWLLGGFSVLGLVLFVHKHSEIEPRPPLSERNYRKEEVNHEGLNFTEEMLSATSFSRQL 79 (534)
T ss_pred CCCchhhcccchhcchhhh-HHHHHHHHHHHHHHHHHhccCCCCCCCCCccccccccccccccccchhhhcChHHHHHHH
Confidence 8999999999999999999 9999999999999999855555 55999999999888777 9999999999999999999
Q ss_pred hhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHH
Q 009572 79 TDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRL 158 (532)
Q Consensus 79 ~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl 158 (532)
||||||||||++|||++||++|++||++||||+||+||+|++|+++++++++.++|+.|+++|++||+++|||+++++||
T Consensus 80 ~dql~~Ak~y~~ia~~~~~~~l~~el~~~i~e~~~~l~~a~~d~~~~~~~~~~~~~~~m~~~i~~ak~~~~d~~~~~~kl 159 (534)
T PLN02742 80 ADQITLAKAYVVIAKEHNNLQLAWELSAQIRNCQLLLSKAATRGEPITVEEAEPIIRDLAALIYQAQDLHYDSATTIMTL 159 (534)
T ss_pred HHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHHHhhcccccCCchhHHHHHHHHHHHHHHHHhccccHHHHHHHH
Confidence 99999999999999999999999999999999999999999999987778999999999999999999999999999999
Q ss_pred HHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhCchhHhhhhhhhccccccCCCceeEEEEeCCCcc
Q 009572 159 KAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNNLYHFCVFSDNILA 238 (532)
Q Consensus 159 ~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~~~hIa~~sDnvl~ 238 (532)
|+|++++||+++++++||+|++||||+|+|||||||+||||+|||++++++++.++++++++++||+++|+|++||||+|
T Consensus 160 r~~l~~~e~~~~~~~~q~~~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~l~Hy~ifSdNvlA 239 (534)
T PLN02742 160 KAHIQALEERANAATVQSTKFGQLAAEALPKSLYCLGVRLTTEWFKNPKLQRKAEEKRNSPRLVDNNLYHFCVFSDNILA 239 (534)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchHhHHHHHhCchhhhccccccccccccCCCcceEEEEeccchh
Confidence 99999999999999999999999999999999999999999999999999887777789999999999999999999999
Q ss_pred chhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccccCcceeeecC
Q 009572 239 TSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQDSETQSYYFSG 318 (532)
Q Consensus 239 ~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~~~~~~~~F~~ 318 (532)
++|+|||++.|+++|++++||||||+.++.+|+.||..|++++++|+|+++++|.|++.+|+|+++|+++++++.|||.+
T Consensus 240 asvvvnStv~nsk~P~~~VFHiVTD~~n~~aM~~WF~~n~~~~a~v~V~n~e~f~wl~~~~~pvl~ql~~~~~~~~yf~~ 319 (534)
T PLN02742 240 TSVVVNSTVSNAKHPDQLVFHLVTDEVNYGAMQAWFAMNDFKGVTVEVQKIEEFSWLNASYVPVLKQLQDSDTQSYYFSG 319 (534)
T ss_pred hhhhhhhhHhhhcCCCcEEEEEeechhhHHHHHHHHhhCCCCccEEEEEEeccccccccccchHHHHhhhhhhhhhhccc
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999987
Q ss_pred CCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchhhhhhhccc
Q 009572 319 NSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMETFHRYHKYL 398 (532)
Q Consensus 319 ~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~~~~~~~~l 398 (532)
+......+.++++|+|+|+++|+||+||++||+++||||||+|+||++||++||++||+|+++|||+||...|++|.+++
T Consensus 320 ~~~~~~~~~k~r~p~y~s~~~y~R~~lP~llp~l~KvlYLD~DvVV~~DL~eL~~~DL~~~viaAVedC~~~f~ry~~yL 399 (534)
T PLN02742 320 SQDDGKTEIKFRNPKYLSMLNHLRFYIPEIYPALEKVVFLDDDVVVQKDLTPLFSIDLHGNVNGAVETCLETFHRYHKYL 399 (534)
T ss_pred ccccccccccccCcccccHHHHHHHHHHHHhhccCeEEEEeCCEEecCChHHHhcCCCCCCEEEEeCchhhhhhhhhhhh
Confidence 76444477899999999999999999999999999999999999999999999999999999999999988899999999
Q ss_pred CCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccCceeecCCccccccC
Q 009572 399 NYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYGLTEPLNPAWHVLGL 478 (532)
Q Consensus 399 n~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~l 478 (532)
||++|+++++|+++.||||+|||||||++||++++|+.++.|++.+.+..+|++|+||+++++|+|++++||.+||+.|+
T Consensus 400 nfS~p~i~~~f~~~aC~fNsGV~ViDL~~WRe~nITe~~~~w~e~n~~~~l~d~gaLpp~LLaF~g~~~~LD~rWNv~gL 479 (534)
T PLN02742 400 NFSHPLISSHFDPDACGWAFGMNVFDLVAWRKANVTAIYHYWQEQNVDRTLWKLGTLPPGLLTFYGLTEPLDRRWHVLGL 479 (534)
T ss_pred cccchhhhccCCCCccccccCcEEEeHHHHHhhcHHHHHHHHHHhccccccccccccchHHHHHcCcceecChhheeccc
Confidence 99999999999999999999999999999999999999999999988889999999999999999999999999999999
Q ss_pred CCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 479 GYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 479 gy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
||+ +++.+.+++|+||||+|++|||.+.+.++|+++|++|+++++|||++||||
T Consensus 480 G~~~~v~~~~i~~aaILHynG~~KPWl~~~i~~yr~~W~kYl~~s~~fl~~Cni~ 534 (534)
T PLN02742 480 GYDTNIDPRLIESAAVLHFNGNMKPWLKLAIERYKPLWERYVNYSHPYLQQCNFH 534 (534)
T ss_pred ccccccchhhccCCeEEEECCCCCcccccCCcccchHHHHHHccCCHHHHhCCCC
Confidence 997 667778999999999999999999999999999999999999999999997
No 2
>PLN02829 Probable galacturonosyltransferase
Probab=100.00 E-value=3.5e-132 Score=1066.97 Aligned_cols=481 Identities=48% Similarity=0.899 Sum_probs=457.9
Q ss_pred CCCCCccchhhhc-cCCCccccccChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCC
Q 009572 47 TFPKRYDRRDRIM-EGLNITDEMLSANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPL 125 (532)
Q Consensus 47 ~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 125 (532)
..+++...+++.. +..+-|+|.+++|++||+|||||||||||++|||++||++|+|||+++|||+||+||+|++|+++
T Consensus 156 ~~~~~~~~~~~~~~~~~~~~~~~~~~d~~v~~lkDql~~AkaY~~iak~~~~~~l~~el~~~i~e~~r~l~~a~~d~~l- 234 (639)
T PLN02829 156 QTSEKVDEKEPLLTKTDKQTDQTVMPDARVRQLRDQLIKAKVYLSLPATKANPHFTRELRLRIKEVQRVLGDASKDSDL- 234 (639)
T ss_pred ccccccccccccccccccccccccCchHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhhccCCCCC-
Confidence 3445556666666 66788999999999999999999999999999999999999999999999999999999999997
Q ss_pred CchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhC
Q 009572 126 TTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGN 205 (532)
Q Consensus 126 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~ 205 (532)
|+++.++|+.|+++|++||+++|||++|++|||+|++++||++++|++|++|++||||+|+|||||||+||||+|||++
T Consensus 235 -p~~~~~~~~~m~~~i~~ak~~~~d~~~~~~KLr~~l~~~Ee~~~~~~~q~~~l~~laa~t~PK~lHCL~mrLt~Ey~~~ 313 (639)
T PLN02829 235 -PKNANEKLKAMEQTLAKGKQMQDDCSIVVKKLRAMLHSAEEQLRVHKKQTMFLTQLTAKTLPKGLHCLPLRLTTEYYNL 313 (639)
T ss_pred -ChhHHHHHHHHHHHHHHHHhcccCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhCCCCccccchhhHHHHHhC
Confidence 5699999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred chhHhhhhhhhccccccCCCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEE
Q 009572 206 QNLQRKLKERKQMEKLTDNNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVE 285 (532)
Q Consensus 206 ~~~~~~~~~~~~~~~l~d~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~ 285 (532)
+++++++| +.++++||+++|||++||||+|+||||||++.|+++|+++|||||||++++.+|++||.+|++++|+|+
T Consensus 314 ~~~~~~~p---~~~~l~dp~l~Hy~ifSdNVLAasVVVnStv~na~~p~k~VFHivTD~~ny~aM~~WF~~n~~~~A~v~ 390 (639)
T PLN02829 314 NSSEQQFP---NQEKLEDPQLYHYALFSDNVLAAAVVVNSTVTNAKHPSKHVFHIVTDRLNYAAMRMWFLVNPPGKATIQ 390 (639)
T ss_pred ChhhccCC---ChhhccCCccceEEEEecceeEEEeeeehhhhcccCccceEEEEecCccchHHHHHHHhhCCCccceEE
Confidence 99877664 567899999999999999999999999999999999999999999999999999999999999999999
Q ss_pred EeeeccchhccccccchhhhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeec
Q 009572 286 VQKFEDFKWLNASYVPVLKQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQ 365 (532)
Q Consensus 286 v~~i~~f~wl~~~y~p~l~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~ 365 (532)
|+|+|+|+|++.+|+|+++|++++.++.|||.........++++|+|+|+|.++|+|||||++||+++||||||+||||+
T Consensus 391 V~nie~f~wln~~~~pvl~ql~~~~~~~~yf~~~~~~~~~~~k~r~p~ylS~lnY~RfyLPeLLP~LdKVLYLD~DVVVq 470 (639)
T PLN02829 391 VQNIEEFTWLNSSYSPVLKQLGSQSMIDYYFRAHRANSDSNLKYRNPKYLSILNHLRFYLPEIFPKLNKVLFLDDDIVVQ 470 (639)
T ss_pred EEehhhcccccccccHHHHHhhhhhhhhhhhhccccCcccccccCCcchhhHHHHHHHHHHHHhcccCeEEEEeCCEEeC
Confidence 99999999999999999999999999999998755444578899999999999999999999999999999999999999
Q ss_pred cCchHHhccCCCCCeeEeeeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcC
Q 009572 366 KDLSALFSINLNGNVNGAVETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNV 445 (532)
Q Consensus 366 ~DLseLw~iDL~g~~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~ 445 (532)
+||++||++||+|+++|||+||...|+++..+++|++|.+..+|+++.||||+|||||||++||++++|++++.|++.+.
T Consensus 471 gDLseLw~iDL~gkviAAVedc~~~f~r~~~~l~fs~p~i~~~Fn~~~CyFNSGVmVINL~~WRe~nITe~y~~wm~~n~ 550 (639)
T PLN02829 471 KDLTGLWSIDLKGNVNGAVETCGESFHRFDRYLNFSNPLISKNFDPHACGWAYGMNVFDLDEWKRQNITEVYHSWQKLNH 550 (639)
T ss_pred CChHHHHhCCCCCceEEEeccchhhhhhhhhhhhccchHhhhccCCcccceecceEEEeHHHHHHhChHHHHHHHHHHcc
Confidence 99999999999999999999998888889999999999988899999999999999999999999999999999999888
Q ss_pred CcccccCCCCChhhhhccCceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCc
Q 009572 446 DRTLWKLGTLPPGLLTFYGLTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHP 524 (532)
Q Consensus 446 d~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~p 524 (532)
++.+|++|+||+++++|+|++++||.+||++|+||+ .+..+.+++|+||||+|++|||.+.++++|+++|.+|+++++|
T Consensus 551 ~r~L~dlgaLPp~Ll~F~g~i~~LD~rWNv~GLGy~~~v~~~~i~~aaIIHynG~~KPWle~~i~~yr~lW~kYl~~~~~ 630 (639)
T PLN02829 551 DRQLWKLGTLPPGLITFWKRTYPLDRSWHVLGLGYNPNVNQRDIERAAVIHYNGNMKPWLEIGIPKYRNYWSKYVDYDQV 630 (639)
T ss_pred CCccccccCCChHHHHhcCceEecChhheecCCCCCcccchhcccCCeEEEECCCCCccccCCcccchHHHHHHHhcCch
Confidence 888999999999999999999999999999999998 5667789999999999999999999999999999999999999
Q ss_pred ccccccCC
Q 009572 525 QLQQCNFH 532 (532)
Q Consensus 525 fl~~cn~~ 532 (532)
||++|||+
T Consensus 631 fl~~Cni~ 638 (639)
T PLN02829 631 YLRECNIN 638 (639)
T ss_pred HHHhCCCC
Confidence 99999996
No 3
>PLN02910 polygalacturonate 4-alpha-galacturonosyltransferase
Probab=100.00 E-value=1.8e-129 Score=1044.18 Aligned_cols=462 Identities=51% Similarity=0.926 Sum_probs=442.9
Q ss_pred ccccChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhh
Q 009572 66 DEMLSANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQ 145 (532)
Q Consensus 66 ~~~~~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 145 (532)
.+...+|+++|+|||||||||||++|||++||++|++||+++|||+||+||+|++|+|+ |+++.++|++|+++|++||
T Consensus 190 ~~~~~~d~~vk~lkDQl~~AkaY~~iak~~~~~~l~~eL~~~i~e~~r~ls~a~~d~dl--p~~~~~k~~~M~~~l~~ak 267 (657)
T PLN02910 190 YESPNSDSILKLMRDQIIMAKAYANIAKSNNVTNLYVSLMKQFRENKRAIGEATSDAEL--HSSALDQAKAMGHVLSIAK 267 (657)
T ss_pred ccccCcHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhhccccccc--CchHHHHHHHHHHHHHHHH
Confidence 45567899999999999999999999999999999999999999999999999999998 5699999999999999999
Q ss_pred ccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhCchhHhhhhhhhccccccCCC
Q 009572 146 QFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNN 225 (532)
Q Consensus 146 ~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~ 225 (532)
+++|||++|++|||+||+++||+++++++|++|++||||+|+|||||||+||||+|||+++++++++ ++.++++||+
T Consensus 268 ~~~~d~~~~~~KLraml~~~Ee~~~~~k~qs~~l~qlaa~t~PK~lHCL~mRLt~Ey~~~~~~~~~~---p~~~~l~dp~ 344 (657)
T PLN02910 268 DQLYDCHTMARKLRAMLQSTERKVDALKKKSAFLIQLAAKTVPKPLHCLPLQLAADYFLLGFQNKDY---VNKKKLEDPS 344 (657)
T ss_pred hcccCHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchhhHHHHHhCchhhccC---CChhhccCCc
Confidence 9999999999999999999999999999999999999999999999999999999999999988765 4567999999
Q ss_pred ceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhh
Q 009572 226 LYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQ 305 (532)
Q Consensus 226 ~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~q 305 (532)
++|||++||||+|+||||||++.|+++|+++|||||||++++.+|++||.+|++++|+|||+|+|+|+|++.+|+|+++|
T Consensus 345 l~Hy~ifSDNVLAaSVVVnSTv~na~~P~k~VFHiVTD~~ny~aM~~WF~~n~~~~A~V~V~nie~f~wln~~~~pvl~q 424 (657)
T PLN02910 345 LYHYAIFSDNVLATSVVVNSTVLHAKEPQKHVFHIVTDKLNFAAMKMWFIINPPAKATIQVENIDDFKWLNSSYCSVLRQ 424 (657)
T ss_pred ceeEEEEecceeeEEeehhhhhhcccCccceEEEEecCccccHHHHHHHhhCCCccceEEEeehhhcccccccccHHHHH
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred ccccCcceeeecCCC----CCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCee
Q 009572 306 LQDSETQSYYFSGNS----DGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVN 381 (532)
Q Consensus 306 l~~~~~~~~~F~~~~----~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~i 381 (532)
+++..+..|||..+. ..+..++++|+|+|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++
T Consensus 425 les~~~~~~yf~~~~~~~~~~~~~~~k~r~p~ylS~lnY~Rf~LPelLp~l~KVLYLD~DVVV~gDLseLw~iDL~g~v~ 504 (657)
T PLN02910 425 LESARIKEYYFKANHPSSLSAGADNLKYRNPKYLSMLNHLRFYLPEVYPKLEKILFLDDDIVVQKDLTPLWSIDMQGMVN 504 (657)
T ss_pred HhhhhhhhhhhhccccccccccccccccCCcchhhHHHHHHHHHHHHhhhcCeEEEEeCCEEecCchHHHHhCCcCCceE
Confidence 999999999998532 2234578999999999999999999999999999999999999999999999999999999
Q ss_pred EeeeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhh
Q 009572 382 GAVETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLT 461 (532)
Q Consensus 382 aAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~ 461 (532)
|||+||...|+++..+++|++|.+++.|+++.||||+|||||||++||++++|+.++.|++.+.+..+|++|+|||++++
T Consensus 505 AAVedc~~~f~r~~~ylnfs~P~i~~yFNs~aCyfNsGVmVIDL~~WRe~nITe~ye~w~eln~~~~L~dqgsLPpgLLv 584 (657)
T PLN02910 505 GAVETCKESFHRFDKYLNFSNPKISENFDPNACGWAFGMNMFDLKEWRKRNITGIYHYWQDLNEDRTLWKLGSLPPGLIT 584 (657)
T ss_pred EEecccchhhhhhhhhhccCChhhhhccCCCCceeecccEEEeHHHHHHhhHHHHHHHHHHhcccccccccCCCChHHHH
Confidence 99999998888999999999999998999999999999999999999999999999999999888899999999999999
Q ss_pred ccCceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 462 FYGLTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 462 F~~~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
|+|++++||.+||++|+||+ .+..+.+++|+||||+|++|||.+.+.++|+++|.+|++.++|||++|||+
T Consensus 585 F~g~i~pLD~rWNv~GLGyd~~v~~~~i~~AAVLHynG~~KPWl~l~i~~Yr~~W~kYl~~d~~fl~~Cni~ 656 (657)
T PLN02910 585 FYNLTYPLDRSWHVLGLGYDPALNQTEIENAAVVHYNGNYKPWLDLAIAKYKPYWSRYVQYDNPYLQLCNIS 656 (657)
T ss_pred HhCceeecCchheecCCCCCcccccccccCcEEEEeCCCCCcccccCcccchHHHHHHccCCChHHHhCCCC
Confidence 99999999999999999998 566678999999999999999999999999999999999999999999996
No 4
>PLN02769 Probable galacturonosyltransferase
Probab=100.00 E-value=3.4e-121 Score=988.00 Aligned_cols=451 Identities=35% Similarity=0.600 Sum_probs=418.8
Q ss_pred cccChhhHHHHhhhHHHHHHHHH-HHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhh
Q 009572 67 EMLSANSVTRQLTDQISLAKAFV-VIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQ 145 (532)
Q Consensus 67 ~~~~~~~~~~~~~dq~~~a~~y~-~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 145 (532)
+...+|++||+|||||||||||+ +|||++||++|+|||++||||+||+||++++|+|+ |+++.++|++|+++|++||
T Consensus 175 ~~~~~d~~~~~l~Dql~~Ak~y~~~iak~~~~~~l~~el~~~i~e~~~~l~~~~~d~dl--p~~~~~~~~~m~~~~~~ak 252 (629)
T PLN02769 175 KEVMKDSIVKRLKDQLFVARAYYPSIAKLPGQEKLTRELKQNIQEHERVLSESITDADL--PPFIQKKLEKMEQTIARAK 252 (629)
T ss_pred cccCcHHHHHHHHHHHHHHHHHHHhhcccCCcHHHHHHHHHHHHHHHHHHhhccccccC--ChhHHHHHHHHHHHHHHHH
Confidence 44578999999999999999997 99999999999999999999999999999999998 6699999999999999999
Q ss_pred ccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhCchhHhhhhhhhccccccCCC
Q 009572 146 QFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNN 225 (532)
Q Consensus 146 ~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~ 225 (532)
++.|||++|++|||+||+++||+++++++|++|++||||+|+|||||||+||||+|||+++++++++ ++.++++||+
T Consensus 253 ~~~~dc~~~~~klr~~l~~~E~~~~~~~kq~~~l~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~---~~~~~l~d~~ 329 (629)
T PLN02769 253 SCPVDCNNVDRKLRQILDMTEDEAHFHMKQSAFLYQLGVQTMPKSHHCLSMRLTVEYFKSSSLDMED---SNSEKFSDPS 329 (629)
T ss_pred hhccchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhcCCCccccchhhHHHHHhCchhhccC---CchhhccCCc
Confidence 9999999999999999999999999999999999999999999999999999999999999988765 4667999999
Q ss_pred ceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhh
Q 009572 226 LYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQ 305 (532)
Q Consensus 226 ~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~q 305 (532)
++|||++||||+|+||+|||++.|+++|++++||||||++++.+|++||..|++++|+|||+|+|+|+|.+. .+|+++|
T Consensus 330 l~Hy~ifSdNvlAasvvvNStv~na~~p~~~VFHiVTD~~n~~am~~WF~~n~~~~a~v~v~n~e~~~~~~~-~~~~~~~ 408 (629)
T PLN02769 330 LRHYVIFSKNVLAASVVINSTVVHSRESGNIVFHVLTDAQNYYAMKHWFDRNSYKEAAVQVLNIEDLILKDL-DKFALKQ 408 (629)
T ss_pred cceEEEEeccceeeeeehhhhhhhccCccceEEEEecChhhHHHHHHHHhcCCCccceEEEeeeeeeeeccc-chHHHHh
Confidence 999999999999999999999999999999999999999999999999999999999999999999999765 4789999
Q ss_pred ccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeee
Q 009572 306 LQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVE 385 (532)
Q Consensus 306 l~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~ 385 (532)
++..+...++|..+.. .+.++++++|+|+++|+|||||++||+++||||||+||||++||++||++||+|+++|||+
T Consensus 409 l~~~~~~~~~~~~~~~---~~~~~~~~eyiS~~nh~RfyIPELLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkviAAVe 485 (629)
T PLN02769 409 LSLPEEFRVSFRSVDN---PSSKQMRTEYLSVFSHSHFLLPEIFKKLKKVVVLDDDVVVQRDLSFLWNLDMGGKVNGAVQ 485 (629)
T ss_pred hccchhhhhhhccCCC---CchhccCcccccHHHHHHHHHHHHhhhcCeEEEEeCCEEecCcHHHHhcCCCCCCeEEEeh
Confidence 9988877777765432 3456778999999999999999999999999999999999999999999999999999999
Q ss_pred ccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcC--CcccccCCCCChhhhhcc
Q 009572 386 TCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNV--DRTLWKLGTLPPGLLTFY 463 (532)
Q Consensus 386 Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~--d~~l~~~~~L~~~n~~F~ 463 (532)
||...+.++..|++ ..+|+++.||||+|||||||++||++++++++++|++.+. +...|++++||++|++|+
T Consensus 486 dc~~rl~~~~~yl~------~~~F~~~~CyFNSGVLLINL~~WRk~nITe~~~~~~~~~~~~~~~~~~~~~Lp~lnlvF~ 559 (629)
T PLN02769 486 FCGVRLGQLKNYLG------DTNFDTNSCAWMSGLNVIDLDKWRELDVTETYLKLLQKFSKDGEESLRAAALPASLLTFQ 559 (629)
T ss_pred hhhhhhhhhhhhhc------ccCCCccccccccCeeEeeHHHHHHhCHHHHHHHHHHHhhhcccccccccCcCHHHHHhc
Confidence 99866655554443 2357889999999999999999999999999999987653 357899999999999999
Q ss_pred CceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 464 GLTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 464 ~~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
|++++||.+||++++||+ .++.+.+++|+||||+|+.|||++.+.++|+++|++|++.++|||++|||+
T Consensus 560 g~v~~LD~rWNv~gLG~~~~i~~~~i~~paIIHYnG~~KPW~e~~i~~yr~~W~kYl~~~~~fl~~Cni~ 629 (629)
T PLN02769 560 DLIYPLDDRWVLSGLGHDYGIDEQAIKKAAVLHYNGNMKPWLELGIPKYKKYWKRFLNRDDRFMDECNVN 629 (629)
T ss_pred CeEEECCHHHccccccccccccccccCCcEEEEECCCCCCccCCCCChHHHHHHHHhccCChHHhhCCCC
Confidence 999999999999999987 566678899999999999999999999999999999999999999999996
No 5
>PLN02718 Probable galacturonosyltransferase
Probab=100.00 E-value=5.9e-118 Score=959.28 Aligned_cols=443 Identities=42% Similarity=0.782 Sum_probs=417.8
Q ss_pred ccccccChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHH
Q 009572 64 ITDEMLSANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQ 143 (532)
Q Consensus 64 ~~~~~~~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 143 (532)
-|.....+|++||+|||||||||||++|||++||++|+|||+++|||+||+||+|+.|+++ |+++.++|+.|++++++
T Consensus 156 ~~~~~~~~d~~v~~~~dql~~ak~y~~~a~~~~~~~~~~el~~~i~e~~~~l~~~~~d~~l--p~~~~~~~~~m~~~~~~ 233 (603)
T PLN02718 156 RVQPRRATDEKVKEIRDKIIQAKAYLNLAPPGSNSQLVKELRLRTKELERAVGDATKDKDL--SKSALQRMKSMEVTLYK 233 (603)
T ss_pred cCCcccCcHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHhcccCCCCC--CHhHHHHHHHHHHHHHH
Confidence 3455567999999999999999999999999999999999999999999999999999986 67999999999999999
Q ss_pred hhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhCchhHhhhhhhhccccccC
Q 009572 144 AQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTD 223 (532)
Q Consensus 144 ~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d 223 (532)
||+++|||++|++|||+|++++||++++|++|++|++||||+|+|||||||+||||+|||+++++++++ |+.++++|
T Consensus 234 a~~~~~d~~~~~~klr~~~~~~e~~~~~~~~q~~~~~~laa~~~PK~lhCL~~rLt~ey~~~~~~~~~~---~~~~~l~d 310 (603)
T PLN02718 234 ASRVFPNCPAIATKLRAMTYNTEEQVRAQKNQAAYLMQLAARTTPKGLHCLSMRLTAEYFALDPEKRQL---PNQQRYND 310 (603)
T ss_pred HHhccccHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhcCCCccccchhhHHHHhhCChhhccC---CChhhccC
Confidence 999999999999999999999999999999999999999999999999999999999999999988876 46679999
Q ss_pred CCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchh
Q 009572 224 NNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVL 303 (532)
Q Consensus 224 ~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l 303 (532)
|+++|||+++||++++||+|+|++.|+++|++++||||||++++++|+.||..++..+++|+|+++++|.|++.+|++.+
T Consensus 311 ~~~~Hia~~sDNvlaasVvInSil~Ns~np~~ivFHVvTD~is~~~mk~wf~l~~~~~a~I~V~~Iddf~~lp~~~~~~l 390 (603)
T PLN02718 311 PDLYHYVVFSDNVLACSVVVNSTISSSKEPEKIVFHVVTDSLNYPAISMWFLLNPPGKATIQILNIDDMNVLPADYNSLL 390 (603)
T ss_pred CcceeEEEEcCCceeEEEEhhhhhhccCCCCcEEEEEEeCCCCHHHHHHHHHhCCCCCcEEEEEecchhccccccchhhh
Confidence 99999999999999999999999999988889999999999999999999999988899999999999999999988877
Q ss_pred hhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEe
Q 009572 304 KQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGA 383 (532)
Q Consensus 304 ~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaA 383 (532)
++++. .+++|+|.++|+||+||++||+++||||||+|+||++||++||++||+|+++||
T Consensus 391 k~l~s---------------------~~~~~~S~~~y~Rl~ipellp~l~KvLYLD~DvVV~~DL~eL~~iDl~~~v~aa 449 (603)
T PLN02718 391 MKQNS---------------------HDPRYISALNHARFYLPDIFPGLNKIVLFDHDVVVQRDLSRLWSLDMKGKVVGA 449 (603)
T ss_pred hhccc---------------------cccccccHHHHHHHHHHHHhcccCEEEEEECCEEecCCHHHHhcCCCCCcEEEE
Confidence 65532 236799999999999999999999999999999999999999999999999999
Q ss_pred eeccch---hhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhh
Q 009572 384 VETCME---TFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLL 460 (532)
Q Consensus 384 V~Dc~~---~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~ 460 (532)
|+||.. .++++..+++|++|++.++|+++.||||+|||||||++||++++++++++|++.+.++.+|++|+||++|+
T Consensus 450 VedC~~~~~~~~~~~~~lnfs~p~i~~~fn~~~CyfNsGVlLIDLk~WReenITe~~~~~l~~n~~~~l~dqdaLpp~Ll 529 (603)
T PLN02718 450 VETCLEGEPSFRSMDTFINFSDPWVAKKFDPKACTWAFGMNLFDLEEWRRQKLTSVYHKYLQLGVKRPLWKAGSLPIGWL 529 (603)
T ss_pred eccccccccchhhhhhhhhccchhhhcccCCCccccccceEEEeHHHHHhcChHHHHHHHHHhccCccccCcccccHHHH
Confidence 999975 35566678999999988889999999999999999999999999999999999888778999999999999
Q ss_pred hccCceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 461 TFYGLTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 461 ~F~~~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
+|+|++++||++||++++||+ .+..+.+++|+||||+|++|||.+.+.+.|+++|.+|+++++|||++||||
T Consensus 530 vF~gri~~LD~rWNv~gLG~~~~i~~~~i~~aaIIHYnG~~KPWle~~i~~yr~~W~k~v~~~~~~l~~Cn~~ 602 (603)
T PLN02718 530 TFYNQTVALDKRWHVLGLGHESGVGASDIEQAAVIHYDGVMKPWLDIGIGKYKRYWNIHVPYHHPYLQQCNIH 602 (603)
T ss_pred HhcCceeecChHHhccCccccccccccccCCCEEEEECCCCCccccCChhhHHHHHHhhcCCCChHHHhcCCC
Confidence 999999999999999999987 556667899999999999999999999999999999999999999999996
No 6
>PLN02523 galacturonosyltransferase
Probab=100.00 E-value=2.4e-111 Score=898.66 Aligned_cols=462 Identities=46% Similarity=0.864 Sum_probs=424.8
Q ss_pred cChhhHHHHhhhHHHHHHHHHHHHhcC--CchHHHHHHHHHHHHHHHHhhhhhcCC-----------CC--CCchhHHHH
Q 009572 69 LSANSVTRQLTDQISLAKAFVVIAKES--NNLQFAWELSAQIRNSQVLLSNAATRR-----------TP--LTTRETETA 133 (532)
Q Consensus 69 ~~~~~~~~~~~dq~~~a~~y~~~a~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~-----------~~--~~~~~~~~~ 133 (532)
++.|.|.||..|+..++.||++.|++. .+++++|-+..-.+++..+.++++..+ +. ..+++|.++
T Consensus 78 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 157 (559)
T PLN02523 78 TRLDQIRKQADDHRTLVNAYAAYARKLKLDNSKLLRLFADLSRNFTDLISKPSYRALLSSDGSAIDEDVLRQFEKEVKER 157 (559)
T ss_pred hHHHHHHHHHHHHHHHHHHHHHHHHHhhhhHHHHHHHHHHHHhHHHHhhcCccccccccccCCcCchHHHhhcchhHHHH
Confidence 466999999999999999999999875 677777777777777776666443311 00 127899999
Q ss_pred HHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhhCchhHhhhh
Q 009572 134 IRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLK 213 (532)
Q Consensus 134 ~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~ 213 (532)
+|.|+++|++||+ .|||+++++|||+|++++||+++++++|++|++||||+|+|||||||+||||+|||++++.+...
T Consensus 158 ~k~~~~~~~~a~~-~~d~~~~~~kl~~~~~~~e~~~~~~~~q~~~~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~- 235 (559)
T PLN02523 158 VKVARQMIAESKE-SFDNQLKIQKLKDTIFAVNEQLTKAKKNGAFASLIAAKSIPKSLHCLAMRLMEERIAHPEKYKDE- 235 (559)
T ss_pred HHHHHHHHHHHHh-hcchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhCCCCccchhhHhHHHHHhChHhhhcc-
Confidence 9999999999997 99999999999999999999999999999999999999999999999999999999998875543
Q ss_pred hhhccccccCCCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccch
Q 009572 214 ERKQMEKLTDNNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFK 293 (532)
Q Consensus 214 ~~~~~~~l~d~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~ 293 (532)
++++.++++||+++|+|++||||+|++|+|+|++.|+++|++++||||||++++.+|+.||..|++++++|+|+++++|+
T Consensus 236 ~~~~~~~l~dp~l~Hy~ifSdNvlAAsVvInStv~Ns~~p~~~VFHIVTD~ln~~amk~Wf~~n~~~~a~I~V~~Iedf~ 315 (559)
T PLN02523 236 GKPPPPELEDPSLYHYAIFSDNVIAASVVVNSAVKNAKEPWKHVFHVVTDRMNLAAMKVMFKMRDLNGAHVEVKAVEDYK 315 (559)
T ss_pred CCCcchhccCCCcceEEEecCcchhhhhhHHHHHHccCCCcceEEEEEeCCCCHHHHHHHHhhCCCCCcEEEEEEeehhh
Confidence 44678999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred hccccccchhhhccccCcceeeecCCCC---CCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchH
Q 009572 294 WLNASYVPVLKQLQDSETQSYYFSGNSD---GGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSA 370 (532)
Q Consensus 294 wl~~~y~p~l~ql~~~~~~~~~F~~~~~---~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLse 370 (532)
|++.+|+|+++|+++.+++.+||.++.. ....++++++|+|+|+++|+||+||++||+++||||||+||||++||++
T Consensus 316 ~ln~~~~pvlk~l~s~~~~~~~f~~~~~~~~~~~~~~k~~~p~ylS~~ny~Rf~IPeLLP~ldKVLYLD~DVVVq~DLse 395 (559)
T PLN02523 316 FLNSSYVPVLRQLESANLQKFYFENKLENATKDSSNMKFRNPKYLSMLNHLRFYLPEMYPKLHRILFLDDDVVVQKDLTG 395 (559)
T ss_pred hcccccchHHHhhhhhhhhhhhccccccccccccccccccCcchhhHHHHHHHHHHHHhcccCeEEEEeCCEEecCCHHH
Confidence 9999999999999999999999985421 2235678899999999999999999999999999999999999999999
Q ss_pred HhccCCCCCeeEeeeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccc
Q 009572 371 LFSINLNGNVNGAVETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLW 450 (532)
Q Consensus 371 Lw~iDL~g~~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~ 450 (532)
||++||+|+++|||+||...++++.++++|++|.+++.|+++.||||+|||||||++||++++|++++.|++.+.+..+|
T Consensus 396 Lw~iDL~gkv~aAVeDc~~~~~r~~~~ln~s~p~i~~yFNs~aC~wnsGVmlINL~~WRe~nITek~~~w~~ln~~~~l~ 475 (559)
T PLN02523 396 LWKIDMDGKVNGAVETCFGSFHRYAQYLNFSHPLIKEKFNPKACAWAYGMNIFDLDAWRREKCTEQYHYWQNLNENRTLW 475 (559)
T ss_pred HHhCcCCCceEEEehhhhhHHHHHHHhhcccchhhhhCcCCCcccccCCcEEEeHHHHHHhchHHHHHHHHHhccccccc
Confidence 99999999999999999777788888999999999889999999999999999999999999999999998888888999
Q ss_pred cCCCCChhhhhccCceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccc
Q 009572 451 KLGTLPPGLLTFYGLTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQC 529 (532)
Q Consensus 451 ~~~~L~~~n~~F~~~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~c 529 (532)
++|+||++|++|+|++++||++||++++||+ .++.+.+++|+||||+|++|||.+.+.++|+++|++|+++++||||+|
T Consensus 476 DqdaLpp~LivF~gri~~LD~rWNvlglGy~~~i~~~~i~~paIIHYnG~~KPWle~~i~~yr~~W~kYl~~~~~fl~~C 555 (559)
T PLN02523 476 KLGTLPPGLITFYSTTKPLDKSWHVLGLGYNPSISMDEIRNAAVIHFNGNMKPWLDIAMNQFKPLWTKYVDYDMEFVQAC 555 (559)
T ss_pred cccccchHHHHhcCceEecCchhhccCCccCCCccccccCCCEEEEECCCCCccccCCCCcchHHHHHHHccCCHHHHhC
Confidence 9999999999999999999999999999987 566778899999999999999999999999999999999999999999
Q ss_pred cCC
Q 009572 530 NFH 532 (532)
Q Consensus 530 n~~ 532 (532)
|||
T Consensus 556 n~~ 558 (559)
T PLN02523 556 NFG 558 (559)
T ss_pred CCC
Confidence 997
No 7
>PLN02870 Probable galacturonosyltransferase
Probab=100.00 E-value=8e-109 Score=877.01 Aligned_cols=423 Identities=42% Similarity=0.817 Sum_probs=383.4
Q ss_pred HHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhcccc
Q 009572 99 QFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSK 178 (532)
Q Consensus 99 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~ 178 (532)
++.+|+.+-..| ---+|++.|+++ |.++++. +.+||+.+|||+++++|||+|++++||+++++++|++|
T Consensus 90 ~~~~~~~~~l~~--~~~~~~~~d~~l--p~s~~~~-------~~~~~~~~~d~~~~~~kl~~~~~~~e~~~~~~~~~~~~ 158 (533)
T PLN02870 90 RLVRDFYKILNE--VNTEEIPDGLKL--PDSFSQL-------VSDMKNNHYDAKTFAFVLRAMMEKFERELRESKFAELM 158 (533)
T ss_pred hhHHHHHHHHHH--hccccccccccC--ChhHHHH-------HHHHHhccccHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 466666655544 233678888887 4454444 44888899999999999999999999999999999999
Q ss_pred ccccccccCCccccchhhhhhHHHhhCchhHhhhhhhhccccccCCCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEE
Q 009572 179 YGQIAAEEVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVF 258 (532)
Q Consensus 179 ~~~~a~~~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~F 258 (532)
++|+||+|+|||||||+||||+|||+++++++++|+++..|+++||+++|+|++||||+|+||||||++.|+++|++++|
T Consensus 159 ~~~laa~t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~e~~~~l~dp~~~Hy~ifSdNvLAasVvvnStv~~a~~p~~~VF 238 (533)
T PLN02870 159 NKHFAASSIPKGIHCLSLRLTDEYSSNAHARKQLPSPELLPVLSDNSYHHFVLSTDNILAASVVVSSTVQSSLKPEKIVF 238 (533)
T ss_pred HHHHHHhhcCCCccccchhhHHHHHhCchhhhcCCcccccccccCCcceeEEEEecceeEEEeeeehhhhcccCccceEE
Confidence 99999999999999999999999999999999888877889999999999999999999999999999999999999999
Q ss_pred EEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccccCcceee-ecCCCCC----------CCCCc
Q 009572 259 HLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQDSETQSYY-FSGNSDG----------GRTPI 327 (532)
Q Consensus 259 HIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~~~~~~~~-F~~~~~~----------~~~~l 327 (532)
|||||++|+.+|++||.+|++++|+|||+++|+|+|++.+|+|+++|++++.+..++ |..+... ...++
T Consensus 239 HvvTD~~n~~aM~~WF~~n~~~~a~v~V~~~e~f~wl~~~~~pvl~~~e~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l 318 (533)
T PLN02870 239 HVITDKKTYAGMHSWFALNSVSPAIVEVKGVHQFDWLTRENVPVLEAVESHNGIRNYYHGNHIAGANLSETTPRTFASKL 318 (533)
T ss_pred EEecCccccHHHHHHHhhCCCccceEEEEehhhccccccccchHHHHHhhhHHHHHHhhcccccccccccccchhhhccc
Confidence 999999999999999999999999999999999999999999999999998875444 4432211 12357
Q ss_pred ccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchh-----hhhhhcccCCCC
Q 009572 328 KFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMET-----FHRYHKYLNYSH 402 (532)
Q Consensus 328 k~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~-----~~~~~~~ln~s~ 402 (532)
++++|+|+|+++|+||+||++||+++||||||+||||++||++||++||+|+++|||+||... ++++..|+||++
T Consensus 319 ~~~~p~ylS~lny~Rl~LPelLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkviaAVeDc~~~~~~~~~~~~~~YfNfs~ 398 (533)
T PLN02870 319 QARSPKYISLLNHLRIYLPELFPNLDKVVFLDDDVVIQRDLSPLWDIDLGGKVNGAVETCRGEDEWVMSKRFRNYFNFSH 398 (533)
T ss_pred ccCCccccCHHHHHHHHHHHHhhhcCeEEEEeCCEEecCcHHHHhhCCCCCceEEEEccccccchhhhhhhhhhhccccc
Confidence 889999999999999999999999999999999999999999999999999999999999542 356778999999
Q ss_pred ccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcC--CcccccCCCCChhhhhccCceeecCCccccccCCC
Q 009572 403 PLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNV--DRTLWKLGTLPPGLLTFYGLTEPLNPAWHVLGLGY 480 (532)
Q Consensus 403 p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~--d~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~lgy 480 (532)
|.+..+|+++.||||||||||||++||++++++++++|++.+. +..+|++|+||++|++|+|++++||.+||++++||
T Consensus 399 p~i~~~fd~~~cyfNSGVlLINL~~WRe~nITek~~~~l~~n~~~~l~l~DQdaLp~~livf~g~v~~LD~rWN~~gLgy 478 (533)
T PLN02870 399 PLIAKNLDPEECAWAYGMNIFDLRAWRKTNIRETYHSWLKENLKSNLTMWKLGTLPPALIAFKGHVHPIDPSWHMLGLGY 478 (533)
T ss_pred chhhcccCcccceeeccchhccHHHHHHcChHHHHHHHHHhhhhcCceecccccccHhHHHhcCceEECChHHhcCCCCC
Confidence 9999999999999999999999999999999999999998764 34789999999999999999999999999999998
Q ss_pred C-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 481 T-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 481 ~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
+ +...+.+++|+||||+|++|||++.+.++|+++|.+|+++++|||++|||+
T Consensus 479 ~~~~~~~~i~~aaIIHY~G~~KPW~~~~~~~yr~~W~kYl~~s~~fl~~Cni~ 531 (533)
T PLN02870 479 QSKTNIESVKKAAVIHYNGQSKPWLEIGFEHLRPFWTKYVNYSNDFIRNCHIL 531 (533)
T ss_pred cccccccccCCcEEEEECCCCCCccccCccchhHHHHHHHccCchHhhhcCCC
Confidence 7 445567889999999999999999999999999999999999999999995
No 8
>PLN02867 Probable galacturonosyltransferase
Probab=100.00 E-value=2.2e-108 Score=876.97 Aligned_cols=422 Identities=38% Similarity=0.732 Sum_probs=389.7
Q ss_pred HHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccc
Q 009572 106 AQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAE 185 (532)
Q Consensus 106 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~ 185 (532)
+-.+|++|+|+|++.+.++ ++.++++.+.|++++.++++.+|||++|++|||+|++++||+++++++|++|++||||+
T Consensus 93 ~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~~~~~d~~~~~~kl~am~~~~e~~~~~~~~~~~~~~~laa~ 170 (535)
T PLN02867 93 KLREELTRALVEAKEQDDG--GRGTKGSTESFNDLVKEMTSNRQDIKAFAFRTKAMLLKMERKVQSARQRESIYWHLASH 170 (535)
T ss_pred HHHHHHHHHHHHhhhcccc--CcchhhhhhHHHHHHHHHHhccchHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhh
Confidence 4567889999999999875 78999999999999999999999999999999999999999999999999999999999
Q ss_pred cCCccccchhhhhhHHHhhCchhHhhhhhhhccccccCCCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcc
Q 009572 186 EVPKSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEI 265 (532)
Q Consensus 186 ~~Pk~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~i 265 (532)
|+|||||||+||||+|||+++++++++|++++.|+++||+++|+|++||||+|+||||||++.|+++|++++||||||++
T Consensus 171 t~PK~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~~~Hy~ifSdNvLAasVvvnStv~~a~~p~~~VfHvvTD~~ 250 (535)
T PLN02867 171 GIPKSLHCLCLKLAEEYAVNAMARSRLPPPESVSRLTDPSFHHVVLLTDNVLAASVVISSTVQNAANPEKLVFHIVTDKK 250 (535)
T ss_pred hcCCCccccchhhHHHHHhCchhhccCCChhhhhhccCCCcceEEEEecceeEEEeeeehhhhcccCccceEEEEecCcc
Confidence 99999999999999999999999999988888999999999999999999999999999999999999999999999999
Q ss_pred cHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccccCcc-e----------eeecCCCCCCCCCcccCCCCc
Q 009572 266 NYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQDSETQ-S----------YYFSGNSDGGRTPIKFRNPKY 334 (532)
Q Consensus 266 s~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~~~~~-~----------~~F~~~~~~~~~~lk~r~~~~ 334 (532)
++.+|++||.+|++++|+|||+++|+|+|++.+|+|+++++++++.. . ++|+.+ ...++++++|+|
T Consensus 251 ny~aM~~WF~~n~~~~a~v~V~~~~~f~wl~~~~~~v~~~~e~~~~~~~~~~~~~~~~~~~~~~~---~~~~~~~~~pky 327 (535)
T PLN02867 251 TYTPMHAWFAINSIKSAVVEVKGLHQYDWSQEVNVGVKEMLEIHRLIWSHYYQNLKESDFQFEGT---HKRSLEALSPSC 327 (535)
T ss_pred ccHHHHHHHhhCCCccceEEEEeehhccccccccccHHHHHHHhhhhhhhhhccccccccccccc---cccchhhcChhh
Confidence 99999999999999999999999999999999999999999876532 2 233322 124788999999
Q ss_pred chhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccc--hh---hhhhhcccCCCCccccccC
Q 009572 335 LSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCM--ET---FHRYHKYLNYSHPLIREHF 409 (532)
Q Consensus 335 lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~--~~---~~~~~~~ln~s~p~i~~~~ 409 (532)
+|+++|+||+||++||+++||||||+||||++||++||++||+|+++|||.|+. .. .+++.+|+||++|.+..++
T Consensus 328 lS~lnYlRflIPeLLP~LdKVLYLD~DVVVqgDLseLwdiDL~gkviaAV~D~~c~~~~~~~~~~~~YlNfsnp~i~~~~ 407 (535)
T PLN02867 328 LSLLNHLRIYIPELFPDLNKIVFLDDDVVVQHDLSSLWELDLNGKVVGAVVDSWCGDNCCPGRKYKDYLNFSHPLISSNL 407 (535)
T ss_pred hhHHHHHHHHHHHHhhccCeEEEecCCEEEcCchHHHHhCcCCCCeEEEEeccccccccccchhhhhhccccchhhhccC
Confidence 999999999999999999999999999999999999999999999999998742 21 2456779999999988899
Q ss_pred CCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCC--cccccCCCCChhhhhccCceeecCCccccccCCCC-C-Cch
Q 009572 410 DPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVD--RTLWKLGTLPPGLLTFYGLTEPLNPAWHVLGLGYT-N-VDP 485 (532)
Q Consensus 410 ~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d--~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~lgy~-~-~~~ 485 (532)
+++.||||||||||||++||++++|+++++|++.+.+ ..+|++|+||+++++|+|++++||.+||+.++||+ . ...
T Consensus 408 ~p~~cYFNSGVmLINL~~WRe~nITek~~~~Le~n~~~~~~l~dqd~LN~~LlvF~g~v~~LD~rWNv~gLgy~~~~~~~ 487 (535)
T PLN02867 408 DQERCAWLYGMNVFDLKAWRRTNITEAYHKWLKLSLNSGLQLWQPGALPPALLAFKGHVHPIDPSWHVAGLGSRPPEVPR 487 (535)
T ss_pred CCCCcceecceeeeeHHHHHHhcHHHHHHHHHHhchhcccccccccccchHHHHhcCcEEECChhhcccCCCcccccchh
Confidence 9999999999999999999999999999999998754 47899999999999999999999999999998887 2 334
Q ss_pred hhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 486 QLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 486 ~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
+.+++|+||||+|+.|||++++.++|+++|.+|++.+++|+|+|||+
T Consensus 488 ~~i~~paIIHYnG~~KPW~e~~~~~yR~~W~kyl~~~~~fl~~cni~ 534 (535)
T PLN02867 488 EILESAAVLHFSGPAKPWLEIGFPEVRSLWYRHVNFSDKFIRKCRIM 534 (535)
T ss_pred hhcCCcEEEEECCCCCcccccCCCchhHHHHHhcCccchHHHhcccC
Confidence 56789999999999999999999999999999999999999999995
No 9
>PLN02659 Probable galacturonosyltransferase
Probab=100.00 E-value=4.8e-108 Score=871.24 Aligned_cols=421 Identities=39% Similarity=0.762 Sum_probs=381.5
Q ss_pred HHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCC
Q 009572 109 RNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVP 188 (532)
Q Consensus 109 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~P 188 (532)
+++-|+|-+.....+++. -.+....+++++.++|..+|||++|++|||+|++++||+++++++|+.+++|+||+|+|
T Consensus 93 ~~~~~~~~~~~~~~e~~~---~~~~~~~~~~~~~~~~~~~~d~~~~~~klr~~l~~~E~~~~~~k~~~~~~~~laa~t~P 169 (534)
T PLN02659 93 EVMYQVLEQPLSNDELKG---RSDIPQTLEEFMDEVKNSRSDARAFALKLREMVTLLEQRTRTAKIQEYLYRHVASSSIP 169 (534)
T ss_pred HHHHHHHHhhhcccccCC---ccccchHHHHHHHHHHhccccHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhhhCC
Confidence 344555666333333321 13455789999999999999999999999999999999999999999888899999999
Q ss_pred ccccchhhhhhHHHhhCchhHhhhhhhhccccccCCCceeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHH
Q 009572 189 KSLYCLGVRLTTEWFGNQNLQRKLKERKQMEKLTDNNLYHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYA 268 (532)
Q Consensus 189 k~~hcl~~rl~~e~~~~~~~~~~~~~~~~~~~l~d~~~~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~ 268 (532)
||||||+||||+|||+++++++++|+++..|+++||+++|+|++||||+|+||||||++.|+++|+++|||||||++++.
T Consensus 170 K~lHCL~mrLt~ey~~~~~~~~~~~~~~~~~~l~d~~l~Hy~ifSdNvLAasVVvnStv~~a~~p~~~VFHivTD~~ny~ 249 (534)
T PLN02659 170 KQLHCLALRLANEHSTNAAARLQLPLAELVPALVDNSYFHFVLASDNILAASVVANSLVQNALRPHKFVLHIITDRKTYS 249 (534)
T ss_pred CCccccchhhHHHHHhCchhhhccCCcccccccCCCCcceEEEEecceeEEEeeeehhhhcccCccceEEEEecCccccH
Confidence 99999999999999999999999888888899999999999999999999999999999999999999999999999999
Q ss_pred HHHHHHHhccCCCceEEEeeeccchhccccccchhhhccccCcceeeecCCCC-----------CCCCCcccCCCCcchh
Q 009572 269 AMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQDSETQSYYFSGNSD-----------GGRTPIKFRNPKYLSM 337 (532)
Q Consensus 269 ~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~~~~~~~~F~~~~~-----------~~~~~lk~r~~~~lS~ 337 (532)
+|++||..|++++|+|||+++|+|+|++.+|+|+++|++++.+..++|..+.. ....++++++|+|+|+
T Consensus 250 aM~~WF~~n~~~~a~v~V~~~e~f~wl~~~~~pvl~ql~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~l~~~~p~ylS~ 329 (534)
T PLN02659 250 PMQAWFSLHPLSPAIIEVKALHHFDWFAKGKVPVLEAMEKDQRVRSQFRGGSSAIVANNTEKPHVIAAKLQALSPKYNSV 329 (534)
T ss_pred HHHHHHhhCCCccceEEEEeehhcccccccccHHHHHHhhhhhhhhhhcccccccccccccCccccccccccCCccceeH
Confidence 99999999999999999999999999999999999999988888888863320 0123567899999999
Q ss_pred hhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchh--h---hhhhcccCCCCccccccCCCC
Q 009572 338 LNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMET--F---HRYHKYLNYSHPLIREHFDPD 412 (532)
Q Consensus 338 ~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~--~---~~~~~~ln~s~p~i~~~~~~~ 412 (532)
++|+||+||++||+++||||||+||||++||++||++||+|+++|||+||... + +++..+++|++|.+...|+++
T Consensus 330 ~nY~RL~IPeLLP~LdKVLYLD~DVVVqgDLseLw~iDL~gkv~AAVeDc~~~d~~~~~~~~~~yL~~s~p~i~~yFn~~ 409 (534)
T PLN02659 330 MNHIRIHLPELFPSLNKVVFLDDDIVVQTDLSPLWDIDMNGKVNGAVETCRGEDKFVMSKKLKSYLNFSHPLIAKNFDPN 409 (534)
T ss_pred HHHHHHHHHHHhhhcCeEEEeeCCEEEcCchHHHHhCCCCCcEEEEeeccccccchhhhHHHHHhhcccchhhhhccCcc
Confidence 99999999999999999999999999999999999999999999999999532 2 567778999999998889999
Q ss_pred CCccccceeeeechHHHHhhHHHHHHHHHHhcC--CcccccCCCCChhhhhccCceeecCCccccccCCCC-CCchhhcC
Q 009572 413 ACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNV--DRTLWKLGTLPPGLLTFYGLTEPLNPAWHVLGLGYT-NVDPQLIE 489 (532)
Q Consensus 413 ~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~--d~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~lgy~-~~~~~~~~ 489 (532)
.||||+|||||||++||++++|+++++|++++. +..+|++|+||++|++|+|++++||.+||+.++||+ +...+.++
T Consensus 410 ~cYfNsGVlLINLk~WRe~nITek~l~~l~~n~~~~l~l~DQdaLp~~LivF~g~v~~LD~rWN~~gLg~~~~~~~~~i~ 489 (534)
T PLN02659 410 ECAWAYGMNIFDLEAWRKTNISSTYHHWLEENLKSDLSLWQLGTLPPGLIAFHGHVHVIDPFWHMLGLGYQENTSLADAE 489 (534)
T ss_pred ccceecceeEeeHHHHHhcChHHHHHHHHHhcccccccccccccchHHHHHhcCCEEECChhheecCCcccccccccccC
Confidence 999999999999999999999999999998874 346789999999999999999999999999999987 44455778
Q ss_pred CCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccccccCC
Q 009572 490 KGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQQCNFH 532 (532)
Q Consensus 490 ~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~~cn~~ 532 (532)
+|+||||+|++|||++++.++|+++|.+|+++++||+|+|||+
T Consensus 490 ~paIIHYnG~~KPW~~~~~~~yr~~W~kYl~~s~~fl~~Cni~ 532 (534)
T PLN02659 490 SAGVVHFNGRAKPWLDIAFPQLRPLWAKYIDSSDKFIKSCHIR 532 (534)
T ss_pred CcEEEEECCCCCccccccCCcchhHHHHHhccCCHHHHhcCCC
Confidence 9999999999999999999999999999999999999999996
No 10
>cd06429 GT8_like_1 GT8_like_1 represents a subfamily of GT8 with unknown function. A subfamily of glycosyltransferase family 8 with unknown function: Glycosyltransferase family 8 comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase and inositol 1-alpha-galactosyltransferase. It is classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed.
Probab=100.00 E-value=3.6e-56 Score=447.26 Aligned_cols=254 Identities=54% Similarity=1.011 Sum_probs=228.3
Q ss_pred eeEEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhc
Q 009572 227 YHFCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQL 306 (532)
Q Consensus 227 ~hIa~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql 306 (532)
+|||+++||.++++|+++|++.||++|.+++|||+||+++.+++++||..++..+++|+|++++++.|.+....+.++|+
T Consensus 1 ~hiv~~~Dn~l~~~v~i~S~l~nn~~~~~~~fhvvtd~~s~~~~~~~~~~~~~~~~~i~~~~i~~~~~~~~~~~~~~~~~ 80 (257)
T cd06429 1 IHVVIFSDNRLAAAVVINSSISNNKDPSNLVFHIVTDNQNYGAMRSWFDLNPLKIATVKVLNFDDFKLLGKVKVDSLMQL 80 (257)
T ss_pred CCEEEEecchhHHHHHHHHHHHhCCCCCceEEEEecCccCHHHHHHHHHhcCCCCceEEEEEeCcHHhhcccccchhhhh
Confidence 69999999988999999999999999889999999999999999999999988899999999998888777666777777
Q ss_pred cccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeec
Q 009572 307 QDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVET 386 (532)
Q Consensus 307 ~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~D 386 (532)
+... ...++++++++++|.++|+||+||++||+++||||||+|+||++||++||++||+|+++|||+|
T Consensus 81 ~~~~------------~~~~~~~~~~~~~s~~~y~Rl~ip~llp~~~kvlYLD~Dviv~~dl~eL~~~dl~~~~~aav~d 148 (257)
T cd06429 81 ESEA------------DTSNLKQRKPEYISLLNFARFYLPELFPKLEKVIYLDDDVVVQKDLTELWNTDLGGGVAGAVET 148 (257)
T ss_pred hccc------------cccccccCCccccCHHHHHHHHHHHHhhhhCeEEEEeCCEEEeCCHHHHhhCCCCCCEEEEEhh
Confidence 6532 1134556678999999999999999999999999999999999999999999999999999976
Q ss_pred cchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCc--ccccCCCCChhhhhccC
Q 009572 387 CMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDR--TLWKLGTLPPGLLTFYG 464 (532)
Q Consensus 387 c~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~--~l~~~~~L~~~n~~F~~ 464 (532)
|||||||||||++||++++++++.+|++.+.++ .++++++||++|++|+|
T Consensus 149 ----------------------------yfNsGV~linl~~wr~~~i~~~~~~~~~~~~~~~~~~~~~~dqd~ln~~~~~ 200 (257)
T cd06429 149 ----------------------------SWNPGVNVVNLTEWRRQNVTETYEKWMELNQEEEVTLWKLITLPPGLIVFYG 200 (257)
T ss_pred ----------------------------hcccceEEEeHHHHHhccHHHHHHHHHHHhhhcccchhhcCCccHHHHHccC
Confidence 589999999999999999999999999876653 56888999999999999
Q ss_pred ceeecCCccccccCCCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHh
Q 009572 465 LTEPLNPAWHVLGLGYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVD 520 (532)
Q Consensus 465 ~i~~L~~~WN~~~lgy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~ 520 (532)
++..||.+||+++++|+ ....+.+++|+||||+|+.|||+..+.++|+++||+|+.
T Consensus 201 ~~~~L~~~wN~~~l~~~~~~~~~~~~~~~IIHy~G~~KPW~~~~~~~~~~~w~~yl~ 257 (257)
T cd06429 201 LTSPLDPSWHVRGLGYNYGIRPQDIKAAAVLHFNGNMKPWLRTAIPSYKELWEKYLS 257 (257)
T ss_pred eeEECChHHcccCCcccccccccccCCcEEEEECCCCCCcCCCCCChHHHHHHHHhC
Confidence 99999999999988876 223456779999999999999999998999999999974
No 11
>PRK15171 lipopolysaccharide 1,3-galactosyltransferase; Provisional
Probab=100.00 E-value=6.2e-45 Score=378.79 Aligned_cols=262 Identities=17% Similarity=0.249 Sum_probs=197.6
Q ss_pred CCceeEEEEeCC--CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccc
Q 009572 224 NNLYHFCVFSDN--ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVP 301 (532)
Q Consensus 224 ~~~~hIa~~sDn--vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p 301 (532)
++.+|||+++|+ +.+++|+|.|+++|+++. .++|||++++++.+.++.+-......+.+|++..++. +
T Consensus 23 ~~~i~Iv~~~D~ny~~~~~vsi~Sil~nn~~~-~~~f~Il~~~is~e~~~~l~~l~~~~~~~i~~~~id~-~-------- 92 (334)
T PRK15171 23 KNSLDIAYGIDKNFLFGCGVSIASVLLNNPDK-SLVFHVFTDYISDADKQRFSALAKQYNTRINIYLINC-E-------- 92 (334)
T ss_pred CCceeEEEECcHhhHHHHHHHHHHHHHhCCCC-CEEEEEEeCCCCHHHHHHHHHHHHhcCCeEEEEEeCH-H--------
Confidence 478999999997 789999999999998763 7999999999999998876433222244555543321 0
Q ss_pred hhhhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCC-CCeEEEEecceeeccCchHHhccCCCCCe
Q 009572 302 VLKQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPA-LKKVVFLDDDVVVQKDLSALFSINLNGNV 380 (532)
Q Consensus 302 ~l~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~-ldKVLYLD~DvIV~~DLseLw~iDL~g~~ 380 (532)
. |. + .+ ...++|.++|+||+||++||+ ++||||||+|+||++||++||++|++|+.
T Consensus 93 ---~----------~~-----~-~~----~~~~~s~atY~Rl~ip~llp~~~dkvLYLD~Diiv~~dl~~L~~~dl~~~~ 149 (334)
T PRK15171 93 ---R----------LK-----S-LP----STKNWTYATYFRFIIADYFIDKTDKVLYLDADIACKGSIKELIDLDFAENE 149 (334)
T ss_pred ---H----------Hh-----C-Cc----ccCcCCHHHHHHHHHHHhhhhhcCEEEEeeCCEEecCCHHHHHhccCCCCe
Confidence 0 00 0 01 135789999999999999995 99999999999999999999999999666
Q ss_pred eEee-eccchh-hhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChh
Q 009572 381 NGAV-ETCMET-FHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPG 458 (532)
Q Consensus 381 iaAV-~Dc~~~-~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~ 458 (532)
+||| .|+... +......++. | ++ ...|||||||||||++||++++++++.+++..+.-...+..+||+++
T Consensus 150 ~aav~~d~~~~~~~~~~~~l~~--~----~~--~~~YFNsGVlliNl~~wRe~~i~~k~~~~l~~~~~~~~~~~~DQDiL 221 (334)
T PRK15171 150 IAAVVAEGDAEWWSKRAQSLQT--P----GL--ASGYFNSGFLLINIPAWAQENISAKAIEMLADPEIVSRITHLDQDVL 221 (334)
T ss_pred EEEEEeccchhHHHHHHHhcCC--c----cc--cccceecceEEEcHHHHHHhhHHHHHHHHHhccccccceeecChhHH
Confidence 6665 555322 1222222221 0 11 24699999999999999999999999999875431122334688999
Q ss_pred hhhccCceeecCCcccccc-CCCC---CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHHhcCCcccc
Q 009572 459 LLTFYGLTEPLNPAWHVLG-LGYT---NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYVDYNHPQLQ 527 (532)
Q Consensus 459 n~~F~~~i~~L~~~WN~~~-lgy~---~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~~~t~pfl~ 527 (532)
|++|.|+++.||.+||++. ..+. .......++|+||||+|+.|||+..+.++++++||+|.+.| ||-.
T Consensus 222 N~~~~~~~~~L~~~wN~~~~~~~~~~~~~~~~~~~~p~IIHy~G~~KPW~~~~~~~~~~~f~~~~~~s-pw~~ 293 (334)
T PRK15171 222 NILLAGKVKFIDAKYNTQFSLNYELKDSVINPVNDETVFIHYIGPTKPWHSWADYPVSQYFLKAKEAS-PWKN 293 (334)
T ss_pred HHHHcCCeEECCHhhCCccchhHHHHhcccccccCCCEEEEECCCCCCCCCCCCCchHHHHHHHHhcC-CCCC
Confidence 9999999999999999873 2221 11122346899999999999999999899999999999998 8863
No 12
>cd06431 GT8_LARGE_C LARGE catalytic domain has closest homology to GT8 glycosyltransferase involved in lipooligosaccharide synthesis. The catalytic domain of LARGE is a putative glycosyltransferase. Mutations of LARGE in mouse and human cause dystroglycanopathies, a disease associated with hypoglycosylation of the membrane protein alpha-dystroglycan (alpha-DG) and consequent loss of extracellular ligand binding. LARGE needs to both physically interact with alpha-dystroglycan and function as a glycosyltransferase in order to stimulate alpha-dystroglycan hyperglycosylation. LARGE localizes to the Golgi apparatus and contains three conserved DxD motifs. While two of the motifs are indispensible for glycosylation function, one is important for localization of th eenzyme. LARGE was originally named because it covers approximately large trunck of genomic DNA, more than 600bp long. The predicted protein structure contains an N-terminal cytoplasmic domain, a transmembrane region, a coiled-coil
Probab=100.00 E-value=1.8e-41 Score=344.91 Aligned_cols=260 Identities=22% Similarity=0.265 Sum_probs=189.9
Q ss_pred EEEEeCC-CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhcc
Q 009572 229 FCVFSDN-ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQ 307 (532)
Q Consensus 229 Ia~~sDn-vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~ 307 (532)
||++.+| +.+++|+|.|+++|+.. .++|||++++++.+.++.+.......+++|.+..++++. .
T Consensus 5 iv~~~~~y~~~~~~~i~Sil~n~~~--~~~fhii~d~~s~~~~~~l~~~~~~~~~~i~f~~i~~~~---~---------- 69 (280)
T cd06431 5 IVCAGYNASRDVVTLVKSVLFYRRN--PLHFHLITDEIARRILATLFQTWMVPAVEVSFYNAEELK---S---------- 69 (280)
T ss_pred EEEccCCcHHHHHHHHHHHHHcCCC--CEEEEEEECCcCHHHHHHHHHhccccCcEEEEEEhHHhh---h----------
Confidence 6667777 78999999999999854 599999999999999988865544446666666543210 0
Q ss_pred ccCcceeeecCCCCCCCCCcccCCCCcchh-hhhHHHhhhhhcCC-CCeEEEEecceeeccCchHHhcc--CCCC-CeeE
Q 009572 308 DSETQSYYFSGNSDGGRTPIKFRNPKYLSM-LNHLRFYIPEVFPA-LKKVVFLDDDVVVQKDLSALFSI--NLNG-NVNG 382 (532)
Q Consensus 308 ~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~-~ty~Rf~lPellP~-ldKVLYLD~DvIV~~DLseLw~i--DL~g-~~ia 382 (532)
.+. . . . ..++|. ++|+||+||++||+ ++||||||+|+||++||++||++ |+.| +++|
T Consensus 70 -------~~~-----~-~----~-~~~~s~~y~y~RL~ip~llp~~~dkvLYLD~Diiv~~di~eL~~~~~~~~~~~~~a 131 (280)
T cd06431 70 -------RVS-----W-I----P-NKHYSGIYGLMKLVLTEALPSDLEKVIVLDTDITFATDIAELWKIFHKFTGQQVLG 131 (280)
T ss_pred -------hhc-----c-C----c-ccchhhHHHHHHHHHHHhchhhcCEEEEEcCCEEEcCCHHHHHHHhhhcCCCcEEE
Confidence 000 0 0 0 124554 48899999999995 99999999999999999999998 7765 5777
Q ss_pred eeeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCC-cccccCCCCChhhhh
Q 009572 383 AVETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVD-RTLWKLGTLPPGLLT 461 (532)
Q Consensus 383 AV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d-~~l~~~~~L~~~n~~ 461 (532)
||+|....+....... ..| ......|||||||||||++||++++++++..+.+++.. ..-...+||+++|++
T Consensus 132 ~v~~~~~~~~~~~~~~--~~~-----~~~~~~yFNsGVmlinL~~wR~~~~~~~~~~~~~~~~~~~~~~~~~DQDiLN~v 204 (280)
T cd06431 132 LVENQSDWYLGNLWKN--HRP-----WPALGRGFNTGVILLDLDKLRKMKWESMWRLTAERELMSMLSTSLADQDIFNAV 204 (280)
T ss_pred Eeccchhhhhhhhhhc--cCC-----CcccccceeeeeeeeeHHHHHhhCHHHHHHHHHHHHHhhcCCCCcCcHHHHHHH
Confidence 7777532111100000 011 11223599999999999999999999998766554321 112345789999999
Q ss_pred ccCc---eeecCCccccccCCCCCC--chhhcCCCeEEEccCCCCCcccCCC-CCCHHHHHHHHhcCCccccc
Q 009572 462 FYGL---TEPLNPAWHVLGLGYTNV--DPQLIEKGAVLHYNGNSKPWLKIGM-EKYKPLWEKYVDYNHPQLQQ 528 (532)
Q Consensus 462 F~~~---i~~L~~~WN~~~lgy~~~--~~~~~~~~~IIHy~G~~KPW~~~~~-~~y~~~W~kY~~~t~pfl~~ 528 (532)
|.|+ ++.||++||++....... .....++|+||||+|+.|||...+. ++|+++|.+|.+++++-|+.
T Consensus 205 ~~~~~~~~~~L~~~wN~~~~~~~~~~~~~~~~~~p~IIHf~g~~KPW~~~~~~~~~~~~~~~~~~~~~~~l~~ 277 (280)
T cd06431 205 IKQNPFLVYQLPCAWNVQLSDHTRSEQCYRDVSDLKVIHWNSPKKLRVKNKHVEFFRNLYLTFLEYDGNLLRR 277 (280)
T ss_pred HcCCcceeEECCCccccccCccchHhHhhcCcCCCEEEEeCCCCCCCCcCCCChHHHHHHHHHHhcCchhhhh
Confidence 9999 899999999985321110 0112468999999999999998876 89999999999999888765
No 13
>cd00505 Glyco_transf_8 Members of glycosyltransferase family 8 (GT-8) are involved in lipopolysaccharide biosynthesis and glycogen synthesis. Members of this family are involved in lipopolysaccharide biosynthesis and glycogen synthesis. GT-8 comprises enzymes with a number of known activities: lipopolysaccharide galactosyltransferase, lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase, and N-acetylglucosaminyltransferase. GT-8 enzymes contains a conserved DXD motif which is essential in the coordination of a catalytic divalent cation, most commonly Mn2+.
Probab=100.00 E-value=1.7e-39 Score=323.50 Aligned_cols=237 Identities=16% Similarity=0.255 Sum_probs=177.8
Q ss_pred eeEEEEeCC---CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchh
Q 009572 227 YHFCVFSDN---ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVL 303 (532)
Q Consensus 227 ~hIa~~sDn---vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l 303 (532)
|||++++++ +.+++|+++|+++|+++ .++|||++++++.+..+.+-......+.++++..++...+
T Consensus 1 ~~i~~~a~d~~y~~~~~v~i~Sl~~~~~~--~~~~~il~~~is~~~~~~L~~~~~~~~~~i~~~~~~~~~~--------- 69 (246)
T cd00505 1 IAIVIVATGDEYLRGAIVLMKSVLRHRTK--PLRFHVLTNPLSDTFKAALDNLRKLYNFNYELIPVDILDS--------- 69 (246)
T ss_pred CeEEEEecCcchhHHHHHHHHHHHHhCCC--CeEEEEEEccccHHHHHHHHHHHhccCceEEEEeccccCc---------
Confidence 577765543 78999999999999987 5999999999999888776544333455666654321000
Q ss_pred hhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEe
Q 009572 304 KQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGA 383 (532)
Q Consensus 304 ~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaA 383 (532)
... +. ..+++|..+|+||++|+++|+++||||||+|+||++||++||++|++|+.+||
T Consensus 70 ----------------~~~---~~---~~~~~~~~~y~RL~i~~llp~~~kvlYLD~D~iv~~di~~L~~~~l~~~~~aa 127 (246)
T cd00505 70 ----------------VDS---EH---LKRPIKIVTLTKLHLPNLVPDYDKILYVDADILVLTDIDELWDTPLGGQELAA 127 (246)
T ss_pred ----------------chh---hh---hcCccccceeHHHHHHHHhhccCeEEEEcCCeeeccCHHHHhhccCCCCeEEE
Confidence 000 00 12567889999999999999999999999999999999999999999999999
Q ss_pred eeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhcc
Q 009572 384 VETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFY 463 (532)
Q Consensus 384 V~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~ 463 (532)
|+||..... ..+... ..+...+.+|||||||||||++||++++.+++..+...+.+. ...++|+++|.+|+
T Consensus 128 v~d~~~~~~--~~~~~~-----~~~~~~~~~yfNsGVmlinl~~~r~~~~~~~~~~~~~~~~~~--~~~~DQd~LN~~~~ 198 (246)
T cd00505 128 APDPGDRRE--GKYYRQ-----KRSHLAGPDYFNSGVFVVNLSKERRNQLLKVALEKWLQSLSS--LSGGDQDLLNTFFK 198 (246)
T ss_pred ccCchhhhc--cchhhc-----ccCCCCCCCceeeeeEEEechHHHHHHHHHHHHHHHHhhccc--CccCCcHHHHHHHh
Confidence 999864211 000000 012344578999999999999999888888777655443322 34467889999999
Q ss_pred Cc---eeecCCccccccCCCCC---CchhhcCCCeEEEccCCCCCccc
Q 009572 464 GL---TEPLNPAWHVLGLGYTN---VDPQLIEKGAVLHYNGNSKPWLK 505 (532)
Q Consensus 464 ~~---i~~L~~~WN~~~lgy~~---~~~~~~~~~~IIHy~G~~KPW~~ 505 (532)
++ +..||.+||++..++.. ...+..++|+||||+|+.|||..
T Consensus 199 ~~~~~i~~L~~~wN~~~~~~~~~~~~~~~~~~~~~iiHy~g~~KPW~~ 246 (246)
T cd00505 199 QVPFIVKSLPCIWNVRLTGCYRSLNCFKAFVKNAKVIHFNGPTKPWNK 246 (246)
T ss_pred cCCCeEEECCCeeeEEecCccccccchhhhcCCCEEEEeCCCCCCCCC
Confidence 98 99999999999765442 12346789999999999999963
No 14
>cd04194 GT8_A4GalT_like A4GalT_like proteins catalyze the addition of galactose or glucose residues to the lipooligosaccharide (LOS) or lipopolysaccharide (LPS) of the bacterial cell surface. The members of this family of glycosyltransferases catalyze the addition of galactose or glucose residues to the lipooligosaccharide (LOS) or lipopolysaccharide (LPS) of the bacterial cell surface. The enzymes exhibit broad substrate specificities. The known functions found in this family include: Alpha-1,4-galactosyltransferase, LOS-alpha-1,3-D-galactosyltransferase, UDP-glucose:(galactosyl) LPS alpha1,2-glucosyltransferase, UDP-galactose: (glucosyl) LPS alpha1,2-galactosyltransferase, and UDP-glucose:(glucosyl) LPS alpha1,2-glucosyltransferase. Alpha-1,4-galactosyltransferase from N. meningitidis adds an alpha-galactose from UDP-Gal (the donor) to a terminal lactose (the acceptor) of the LOS structure of outer membrane. LOSs are virulence factors that enable the organism to evade the immune sys
Probab=100.00 E-value=6.2e-39 Score=318.82 Aligned_cols=237 Identities=22% Similarity=0.276 Sum_probs=185.4
Q ss_pred eeEEEEeCC--CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhh
Q 009572 227 YHFCVFSDN--ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLK 304 (532)
Q Consensus 227 ~hIa~~sDn--vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ 304 (532)
+|||+++|+ +.+++|+++|+++|+++ +.++|||++++++.+.++.+-..-...+..|++..++. +...
T Consensus 1 ~~I~~~~d~~y~~~~~~~l~Sl~~~~~~-~~~~~~il~~~is~~~~~~L~~~~~~~~~~i~~~~i~~---------~~~~ 70 (248)
T cd04194 1 MNIVFAIDDNYAPYLAVTIKSILANNSK-RDYDFYILNDDISEENKKKLKELLKKYNSSIEFIKIDN---------DDFK 70 (248)
T ss_pred CCEEEEecHhhHHHHHHHHHHHHhcCCC-CceEEEEEeCCCCHHHHHHHHHHHHhcCCeEEEEEcCH---------HHHh
Confidence 689999997 78999999999999986 47999999999998887765443222355666654331 0000
Q ss_pred hccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEee
Q 009572 305 QLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAV 384 (532)
Q Consensus 305 ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV 384 (532)
. .+. ...+++..+|+||++|+++|+++||||||+|+||++||++||++|++|+++|||
T Consensus 71 ~-------------------~~~---~~~~~~~~~y~rl~l~~ll~~~~rvlylD~D~lv~~di~~L~~~~~~~~~~aa~ 128 (248)
T cd04194 71 F-------------------FPA---TTDHISYATYYRLLIPDLLPDYDKVLYLDADIIVLGDLSELFDIDLGDNLLAAV 128 (248)
T ss_pred c-------------------CCc---ccccccHHHHHHHHHHHHhcccCEEEEEeCCEEecCCHHHHhcCCcCCCEEEEE
Confidence 0 000 135688899999999999999999999999999999999999999999999999
Q ss_pred eccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccC
Q 009572 385 ETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYG 464 (532)
Q Consensus 385 ~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~ 464 (532)
+||.......... ..+.....+||||||||+|+++||++++++++.++++.+.. .+..++|+++|.+|++
T Consensus 129 ~d~~~~~~~~~~~--------~~~~~~~~~yfNsGv~l~nl~~~r~~~~~~~~~~~~~~~~~--~~~~~DQd~LN~~~~~ 198 (248)
T cd04194 129 RDPFIEQEKKRKR--------RLGGYDDGSYFNSGVLLINLKKWREENITEKLLELIKEYGG--RLIYPDQDILNAVLKD 198 (248)
T ss_pred ecccHHHHHHHHh--------hcCCCcccceeeecchheeHHHHHHhhhHHHHHHHHHhCCC--ceeeCChHHHHHHHhC
Confidence 9997543221110 01234567899999999999999999999999999987654 2345688999999999
Q ss_pred ceeecCCccccccCCCCCC---------chhhcCCCeEEEccCCCCCccc
Q 009572 465 LTEPLNPAWHVLGLGYTNV---------DPQLIEKGAVLHYNGNSKPWLK 505 (532)
Q Consensus 465 ~i~~L~~~WN~~~lgy~~~---------~~~~~~~~~IIHy~G~~KPW~~ 505 (532)
++..||.+||++...+... .....++|+||||+|+.|||..
T Consensus 199 ~~~~L~~~~N~~~~~~~~~~~~~~~~~~~~~~~~~~~iiHf~g~~KPW~~ 248 (248)
T cd04194 199 KILYLPPRYNFQTGFYYLLKKKSKEEQELEEARKNPVIIHYTGSDKPWNK 248 (248)
T ss_pred CeEEcCcccccchhHhHHhhccchhHHHHHHHhcCCEEEEeCCCCCCCCC
Confidence 9999999999986544311 1245789999999999999963
No 15
>COG1442 RfaJ Lipopolysaccharide biosynthesis proteins, LPS:glycosyltransferases [Cell envelope biogenesis, outer membrane]
Probab=100.00 E-value=2.5e-37 Score=318.70 Aligned_cols=257 Identities=19% Similarity=0.251 Sum_probs=196.2
Q ss_pred ceeEEEEeCC--CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEE--eeeccchhccccccc
Q 009572 226 LYHFCVFSDN--ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEV--QKFEDFKWLNASYVP 301 (532)
Q Consensus 226 ~~hIa~~sDn--vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v--~~i~~f~wl~~~y~p 301 (532)
.++||+++|+ +.+++|+|.|++.|++.. .+.|||++++++.+.++.+-.....-+..+.+ .+++++
T Consensus 2 ~~~Iv~a~D~nY~~~~gvsI~SiL~~n~~~-~~~fhil~~~i~~e~~~~l~~~~~~f~~~i~~~~id~~~~--------- 71 (325)
T COG1442 2 TIPIAFAFDKNYLIPAGVSIYSLLEHNRKI-FYKFHILVDGLNEEDKKKLNETAEPFKSFIVLEVIDIEPF--------- 71 (325)
T ss_pred cccEEEEcccccchhHHHHHHHHHHhCccc-cEEEEEEecCCCHHHHHHHHHHHHhhccceeeEEEechhh---------
Confidence 4689999997 789999999999999962 69999999999999998875443322222222 221111
Q ss_pred hhhhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCee
Q 009572 302 VLKQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVN 381 (532)
Q Consensus 302 ~l~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~i 381 (532)
+ ..+. .++++|.++|+||+||++||+++|+||||+||||+|||++||.+|++++++
T Consensus 72 -----~----------------~~~~---~~~~~s~~v~~R~fiadlf~~~dK~lylD~Dvi~~g~l~~lf~~~~~~~~~ 127 (325)
T COG1442 72 -----L----------------DYPP---FTKRFSKMVLVRYFLADLFPQYDKMLYLDVDVIFCGDLSELFFIDLEEYYL 127 (325)
T ss_pred -----h----------------cccc---cccchHHHHHHHHHHHHhccccCeEEEEecCEEEcCcHHHHHhcCCCcceE
Confidence 0 0110 246789999999999999999999999999999999999999999999999
Q ss_pred EeeeccchhhhhhhcccCCCCccccc-cCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhh
Q 009572 382 GAVETCMETFHRYHKYLNYSHPLIRE-HFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLL 460 (532)
Q Consensus 382 aAV~Dc~~~~~~~~~~ln~s~p~i~~-~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~ 460 (532)
|||.|+........ .. ++ .......|||||||++|+++||++++++++..+++..++ -...++|+++|.
T Consensus 128 aaV~D~~~~~~~~~--~~------~~~~~~~~~~yFNaG~llinl~~W~~~~i~~k~i~~~~~~~~--~~~~~DQdiLN~ 197 (325)
T COG1442 128 AAVRDVFSHYMKEG--AL------RLEKGDLEGSYFNAGVLLINLKLWREENIFEKLIELLKDKEN--DLLYPDQDILNM 197 (325)
T ss_pred EEEeehhhhhhhhh--hh------HhhhcccccccCccceeeehHHHHHHhhhHHHHHHHHhcccc--ccCCccccHHHH
Confidence 99999864211100 00 00 112346789999999999999999999999999865553 233467999999
Q ss_pred hccCceeecCCccccccCC-CCCCc---hhhcCCCeEEEccCCCCCcccCCCCCC-HHHHHHHHhcCCcccc
Q 009572 461 TFYGLTEPLNPAWHVLGLG-YTNVD---PQLIEKGAVLHYNGNSKPWLKIGMEKY-KPLWEKYVDYNHPQLQ 527 (532)
Q Consensus 461 ~F~~~i~~L~~~WN~~~lg-y~~~~---~~~~~~~~IIHy~G~~KPW~~~~~~~y-~~~W~kY~~~t~pfl~ 527 (532)
+|+|++.+||.+||++... +.-.. ......|.|+||+|+.|||+..+.+.+ ..+|...+..+ ||..
T Consensus 198 i~~~~~~~L~~~YN~~~~~~~~~~~~~~~~~~~~~~iiHy~g~~KPW~~~~~~~~~~~~w~~i~~~~-p~~~ 268 (325)
T COG1442 198 IFEDRVLELPIRYNAIPYIDSQLKDKYIYPFGDDPVILHYAGPTKPWHSDSSNYPRSHEWHEILAET-PWKN 268 (325)
T ss_pred HHHhhhhccCcccceeehhhhccchhhhccCCCCceEEEecCCCCCCcCccccccHHHHHHHHHhcC-Cccc
Confidence 9999999999999998432 11111 334568999999999999999987665 47788777776 7764
No 16
>PF01501 Glyco_transf_8: Glycosyl transferase family 8; InterPro: IPR002495 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. Glycosyltransferase family 8 GT8 from CAZY comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase (2.4.1.44 from EC), lipopolysaccharide glucosyltransferase 1 (2.4.1.58 from EC), glycogenin glucosyltransferase (2.4.1.186 from EC), inositol 1-alpha-galactosyltransferase (2.4.1.123 from EC). These enzymes have a distant similarity to family GT_24. ; GO: 0016757 transferase activity, transferring glycosyl groups; PDB: 1LL0_D 1ZCV_A 3USR_A 3V90_A 1ZCU_A 1ZCT_A 3V91_A 1ZCY_A 1ZDG_A 1ZDF_A ....
Probab=100.00 E-value=1.6e-35 Score=289.22 Aligned_cols=244 Identities=23% Similarity=0.403 Sum_probs=167.8
Q ss_pred eEEEEeCC--CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhh
Q 009572 228 HFCVFSDN--ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQ 305 (532)
Q Consensus 228 hIa~~sDn--vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~q 305 (532)
||++++|. +.+++|+++|+++|++++..++|||++++++.+..+.+........ .+......+. ...++
T Consensus 1 ~i~~~~d~~y~~~~~v~i~Sl~~~~~~~~~~~i~i~~~~~~~~~~~~l~~~~~~~~-~~~~~~~~~~--------~~~~~ 71 (250)
T PF01501_consen 1 HIVLACDDNYLEGAAVLIKSLLKNNPDPSNLHIYIITDDISEEDFEKLRALAAEVI-EIEPIEFPDI--------SMLEE 71 (250)
T ss_dssp -EEEECSGGGHHHHHHHHHHHHHTTTT-SSEEEEEEESSS-HHHHHHHHHHSCCCC-TTECEEETSG--------GHHH-
T ss_pred CEEEEeCHHHHHHHHHHHHHHHHhccccccceEEEecCCCCHHHHHHHhhhccccc-ceeeeccchH--------Hhhhh
Confidence 79999997 7899999999999999877899999999999988877644322111 0110000000 00000
Q ss_pred ccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeee
Q 009572 306 LQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVE 385 (532)
Q Consensus 306 l~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~ 385 (532)
+. . ......+++..+|+||++|++||+++||||||+|+||.+||++||+++++|+.+||++
T Consensus 72 ----------~~----~-----~~~~~~~~~~~~~~rl~i~~ll~~~drilyLD~D~lv~~dl~~lf~~~~~~~~~~a~~ 132 (250)
T PF01501_consen 72 ----------FQ----F-----NSPSKRHFSPATFARLFIPDLLPDYDRILYLDADTLVLGDLDELFDLDLQGKYLAAVE 132 (250)
T ss_dssp -----------T----T-----S-HCCTCGGGGGGGGGGHHHHSTTSSEEEEE-TTEEESS-SHHHHC---TTSSEEEEE
T ss_pred ----------hh----h-----cccccccccHHHHHHhhhHHHHhhcCeEEEEcCCeeeecChhhhhcccchhhhccccc
Confidence 00 0 0012467889999999999999999999999999999999999999999999999999
Q ss_pred ccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccCc
Q 009572 386 TCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYGL 465 (532)
Q Consensus 386 Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~~ 465 (532)
|+...... +...+..........+||||||||+|+++||++++.+++..+++.+.. ....++|+.+|++|+++
T Consensus 133 ~~~~~~~~-----~~~~~~~~~~~~~~~~~fNsGv~l~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~DQ~~ln~~~~~~ 205 (250)
T PF01501_consen 133 DESFDNFP-----NKRFPFSERKQPGNKPYFNSGVMLFNPSKWRKENILQKLIEWLEQNGM--KLGFPDQDILNIVFYGN 205 (250)
T ss_dssp ----HHHH-----TSTTSSEEECESTTTTSEEEEEEEEEHHHHHHHHHHHHHHHHHHHTTT--T-SSCHHHHHHHHHTTG
T ss_pred cchhhhhh-----hcccchhhcccCcccccccCcEEEEeechhhhhhhhhhhhhhhhhccc--ccCcCchHHHhhhccce
Confidence 93211110 001111111233468999999999999999999999999999876554 34457788999999999
Q ss_pred eeecCCccccccCCCC---CCchhhcCCCeEEEccCCCCCcccC
Q 009572 466 TEPLNPAWHVLGLGYT---NVDPQLIEKGAVLHYNGNSKPWLKI 506 (532)
Q Consensus 466 i~~L~~~WN~~~lgy~---~~~~~~~~~~~IIHy~G~~KPW~~~ 506 (532)
+..||.+||++..++. .......++++||||+|..|||...
T Consensus 206 ~~~L~~~~N~~~~~~~~~~~~~~~~~~~~~iiHy~g~~KPW~~~ 249 (250)
T PF01501_consen 206 IKPLPCRYNCQPSWYNQSDDYFNPILEDAKIIHYSGPPKPWKST 249 (250)
T ss_dssp EEEEEGGGSEEHHHHHHTHHHHHHHGCC-SEEE--SSS-TTSTT
T ss_pred eEEECchhccccccccccchhhHhhcCCeEEEEeCCCCcCCCCC
Confidence 9999999999976541 1123456899999999999999875
No 17
>cd06432 GT8_HUGT1_C_like The C-terminal domain of HUGT1-like is highly homologous to the GT 8 family. C-terminal domain of glycoprotein glucosyltransferase (UGT). UGT is a large glycoprotein whose C-terminus contains the catalytic activity. This catalytic C-terminal domain is highly homologous to Glycosyltransferase Family 8 (GT 8) and contains the DXD motif that coordinates donor sugar binding, characteristic for Family 8 glycosyltransferases. GT 8 proteins are retaining enzymes based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed. The non-catalytic N-terminal portion of the human UTG1 (HUGT1) has been shown to monitor the protein folding status and activate its glucosyltransferase activity.
Probab=99.98 E-value=2.8e-32 Score=273.15 Aligned_cols=233 Identities=14% Similarity=0.161 Sum_probs=160.3
Q ss_pred eEEE-EeCC--CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhh
Q 009572 228 HFCV-FSDN--ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLK 304 (532)
Q Consensus 228 hIa~-~sDn--vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ 304 (532)
||.. ++|+ +.+++|++.|+++|+.. +++|||++++++.+..+.+-......++++++..++.-.|+..
T Consensus 2 ni~~~~~~~~y~~~~~v~l~Sll~nn~~--~~~fyil~~~is~e~~~~l~~~~~~~~~~i~~i~i~~~~~~~~------- 72 (248)
T cd06432 2 NIFSVASGHLYERFLRIMMLSVMKNTKS--PVKFWFIKNFLSPQFKEFLPEMAKEYGFEYELVTYKWPRWLHK------- 72 (248)
T ss_pred eEEEEcCcHHHHHHHHHHHHHHHHcCCC--CEEEEEEeCCCCHHHHHHHHHHHHHhCCceEEEEecChhhhhc-------
Confidence 4544 3444 68999999999999853 6999999999999887766433222345566554321011000
Q ss_pred hccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCC-CCeEEEEecceeeccCchHHhccCCCCCeeEe
Q 009572 305 QLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPA-LKKVVFLDDDVVVQKDLSALFSINLNGNVNGA 383 (532)
Q Consensus 305 ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~-ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaA 383 (532)
. ....+ +..+|.|++++++||. ++||||||+|+||.+||++||++||+|+++||
T Consensus 73 --------------------~----~~~~~-~~~~y~rL~~~~lLP~~vdkvLYLD~Dilv~~dL~eL~~~dl~~~~~Aa 127 (248)
T cd06432 73 --------------------Q----TEKQR-IIWGYKILFLDVLFPLNVDKVIFVDADQIVRTDLKELMDMDLKGAPYGY 127 (248)
T ss_pred --------------------c----cccch-hHHHHHHHHHHHhhhhccCEEEEEcCCceecccHHHHHhcCcCCCeEEE
Confidence 0 00011 2457899999999996 99999999999999999999999999999999
Q ss_pred eeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhc-CCcccccCCCCChhhhhc
Q 009572 384 VETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKN-VDRTLWKLGTLPPGLLTF 462 (532)
Q Consensus 384 V~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~-~d~~l~~~~~L~~~n~~F 462 (532)
|+||.... +..+...+.......++ .+..|||||||||||++||++++++++.++++.. .+...+...+|+++|.++
T Consensus 128 v~d~~~~~-~~~~~~~~~~~~~~~~l-~~~~YfNSGVmliNL~~wR~~~i~~~~~~~~~~l~~~~~~l~~~DQDiLN~v~ 205 (248)
T cd06432 128 TPFCDSRK-EMDGFRFWKQGYWKSHL-RGRPYHISALYVVDLKRFRRIAAGDRLRGQYQQLSQDPNSLANLDQDLPNNMQ 205 (248)
T ss_pred eeccccch-hcccchhhhhhhhhhhc-CCCCccceeeEEEeHHHHHHHhHHHHHHHHHHHHhcCCCccccCCchhhHHHh
Confidence 99986421 10000000000001122 2456999999999999999999999877655422 111223345678889999
Q ss_pred cCc-eeecCCccccccCCCCCCchhhcCCCeEEEccCC
Q 009572 463 YGL-TEPLNPAWHVLGLGYTNVDPQLIEKGAVLHYNGN 499 (532)
Q Consensus 463 ~~~-i~~L~~~WN~~~lgy~~~~~~~~~~~~IIHy~G~ 499 (532)
.+. +++||.+||++... . ..+..+.|.+|||..+
T Consensus 206 ~~~~i~~Lp~~w~~~~~~-~--~~~~~~~~~~~~~~~~ 240 (248)
T cd06432 206 HQVPIFSLPQEWLWCETW-C--SDESKKKAKTIDLCNN 240 (248)
T ss_pred ccCCeEECChHHHHHHHH-h--cccccCccceeecccC
Confidence 886 99999999997432 1 2345778999999864
No 18
>cd06430 GT8_like_2 GT8_like_2 represents a subfamily of GT8 with unknown function. A subfamily of glycosyltransferase family 8 with unknown function: Glycosyltransferase family 8 comprises enzymes with a number of known activities; lipopolysaccharide galactosyltransferase lipopolysaccharide glucosyltransferase 1, glycogenin glucosyltransferase and inositol 1-alpha-galactosyltransferase. It is classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed.
Probab=99.98 E-value=1.1e-31 Score=274.35 Aligned_cols=249 Identities=15% Similarity=0.239 Sum_probs=167.4
Q ss_pred eeEEEE-eCC-CccchhhHHHHhhhCCCCCcEEEEEEeCc-ccHHHHHHHHHhccCCCceE--EEeeeccchhccccccc
Q 009572 227 YHFCVF-SDN-ILATSVVVNSTASNSKNPDMIVFHLVTDE-INYAAMKAWFAINSFRGVTV--EVQKFEDFKWLNASYVP 301 (532)
Q Consensus 227 ~hIa~~-sDn-vl~~sV~I~Sil~N~~~p~~i~FHIvtd~-is~~~~~~wf~~n~~~~a~I--~v~~i~~f~wl~~~y~p 301 (532)
+|+|+. +++ +..+-|+|.|++.|+.. .++|||++|+ ++.+..+.+-.........+ .+. .+
T Consensus 1 ~~~~vv~~g~~~~~~~~~lkSil~~n~~--~l~Fhi~~d~~~~~~~~~~l~~~~~~~~~~i~~~i~---~I--------- 66 (304)
T cd06430 1 MHLAVVACGERLEETLTMLKSAIVFSQK--PLRFHIFAEDQLKQSFKEKLDDWPELIDRKFNYTLH---PI--------- 66 (304)
T ss_pred CEEEEEEcCCcHHHHHHHHHHHHHhCCC--CEEEEEEECCccCHHHHHHHHHHHHhccceeeeEEE---EE---------
Confidence 455543 343 77889999999999854 6999999998 44444332211111111112 221 11
Q ss_pred hhhhccccCcceeeecCCCC-CCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhcc--CCCC
Q 009572 302 VLKQLQDSETQSYYFSGNSD-GGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSI--NLNG 378 (532)
Q Consensus 302 ~l~ql~~~~~~~~~F~~~~~-~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~i--DL~g 378 (532)
.|+.+.. .+ +..++..+|+||++|++||+++||||||+|+||.+||++||++ |+++
T Consensus 67 -------------~~P~~~~~~w--------s~l~~~~~y~RL~ip~lLp~~dkvLYLD~Dii~~~dI~eL~~~~~df~~ 125 (304)
T cd06430 67 -------------TFPSGNAAEW--------KKLFKPCAAQRLFLPSLLPDVDSLLYVDTDILFLRPVEEIWSFLKKFNS 125 (304)
T ss_pred -------------ecCccchhhh--------hhcccHHHHHHHHHHHHhhhhceEEEeccceeecCCHHHHHHHHhhcCC
Confidence 1221110 11 1345668999999999999999999999999999999999999 9998
Q ss_pred C-eeEeeeccchh-hhhhhcccCCCCccccccCCCCCCccccceeeeechHHHH-----------hhHHHHHHHHHHhcC
Q 009572 379 N-VNGAVETCMET-FHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRK-----------RNVTGIYHYWQEKNV 445 (532)
Q Consensus 379 ~-~iaAV~Dc~~~-~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~-----------~nit~~~~~~~~~~~ 445 (532)
+ ++|+++|-... ...+.... .+| + ....|||||||+|||++||+ .++++++..+++++.
T Consensus 126 ~~~aA~v~e~~~~~~~~~~~~~--~~~-----~-~~~~gFNSGVmLmNL~~wR~~~~~~~~~~~~~~~~~~~~~~~~~~~ 197 (304)
T cd06430 126 TQLAAMAPEHEEPNIGWYNRFA--RHP-----Y-YGKTGVNSGVMLMNLTRMRRKYFKNDMTPVGLRWEEILMPLYKKYK 197 (304)
T ss_pred CeEEEEEecccccchhhhhhhc--ccC-----c-ccccccccceeeeeHHHHHhhhcccccchhhhhHHHHHHHHHHhcc
Confidence 6 55556653210 00111000 111 1 12347999999999999999 788999999998766
Q ss_pred CcccccCCCCChhhhhccCc---eeecCCccccccC--CCC-CCchhhcCCCeEEEccCCCCCcccCCCCCCHHHHHHHH
Q 009572 446 DRTLWKLGTLPPGLLTFYGL---TEPLNPAWHVLGL--GYT-NVDPQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWEKYV 519 (532)
Q Consensus 446 d~~l~~~~~L~~~n~~F~~~---i~~L~~~WN~~~l--gy~-~~~~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~kY~ 519 (532)
.... .+||+++|++|+++ ++.||++||++.. .|. +......+.++|||++++.| +....+.|+.++....
T Consensus 198 ~~l~--~~DQDiLN~v~~~~p~~~~~Lp~~wN~~~d~~~y~~~~~~~~~~~~~~~H~n~~~~--~~~~~~~f~~~~~~~~ 273 (304)
T cd06430 198 LKIT--WGDQDLINIIFHHNPEMLYVFPCHWNYRPDHCMYGSNCKAAEEEGVFILHGNRGVY--HSDKQPAFRAVYEAIR 273 (304)
T ss_pred cCCC--CCCHHHHHHHHcCCCCeEEEcCccccCCccceeecccccccccccceEEEcCCCCC--CCccchHHHHHHHHHH
Confidence 4433 46789999999998 9999999998752 122 23333457899999998766 3444445788887777
Q ss_pred hcC
Q 009572 520 DYN 522 (532)
Q Consensus 520 ~~t 522 (532)
+++
T Consensus 274 ~~~ 276 (304)
T cd06430 274 EYT 276 (304)
T ss_pred hcc
Confidence 665
No 19
>cd02537 GT8_Glycogenin Glycogenin belongs the GT 8 family and initiates the biosynthesis of glycogen. Glycogenin initiates the biosynthesis of glycogen by incorporating glucose residues through a self-glucosylation reaction at a Tyr residue, and then acts as substrate for chain elongation by glycogen synthase and branching enzyme. It contains a conserved DxD motif and an N-terminal beta-alpha-beta Rossmann-like fold that are common to the nucleotide-binding domains of most glycosyltransferases. The DxD motif is essential for coordination of the catalytic divalent cation, most commonly Mn2+. Glycogenin can be classified as a retaining glycosyltransferase, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed. It is placed in glycosyltransferase family 8 which includes lipopolysaccharide glucose and galactose transferases and galactinol synthases.
Probab=99.93 E-value=4.8e-25 Score=219.53 Aligned_cols=216 Identities=14% Similarity=0.101 Sum_probs=150.7
Q ss_pred EEeC-C-CccchhhHHHHhhhCCCCCcEEEEEE-eCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhcc
Q 009572 231 VFSD-N-ILATSVVVNSTASNSKNPDMIVFHLV-TDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQ 307 (532)
Q Consensus 231 ~~sD-n-vl~~sV~I~Sil~N~~~p~~i~FHIv-td~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~ 307 (532)
+++| + +.+++|++.|+.+|+++ +.++|+ +++++.+.++.+-... .++..++.+++
T Consensus 6 ~~~~~~Y~~~a~vl~~SL~~~~~~---~~~~vl~~~~is~~~~~~L~~~~------~~~~~v~~i~~------------- 63 (240)
T cd02537 6 LLTNDDYLPGALVLGYSLRKVGSS---YDLVVLVTPGVSEESREALEEVG------WIVREVEPIDP------------- 63 (240)
T ss_pred EecChhHHHHHHHHHHHHHhcCCC---CCEEEEECCCCCHHHHHHHHHcC------CEEEecCccCC-------------
Confidence 3344 4 78999999999999875 445554 5579988876653321 22322221110
Q ss_pred ccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeecc
Q 009572 308 DSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETC 387 (532)
Q Consensus 308 ~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc 387 (532)
..... ....+.+..+|.||+++++. .++||||||+|+||.+||++||++ +..+||+.|+
T Consensus 64 ---------~~~~~--------~~~~~~~~~~~~kl~~~~l~-~~drvlylD~D~~v~~~i~~Lf~~---~~~~~a~~d~ 122 (240)
T cd02537 64 ---------PDSAN--------LLKRPRFKDTYTKLRLWNLT-EYDKVVFLDADTLVLRNIDELFDL---PGEFAAAPDC 122 (240)
T ss_pred ---------cchhh--------hccchHHHHHhHHHHhcccc-ccceEEEEeCCeeEccCHHHHhCC---CCceeeeccc
Confidence 00000 00134567889999999975 589999999999999999999987 6778888775
Q ss_pred chhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccCc--
Q 009572 388 METFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYGL-- 465 (532)
Q Consensus 388 ~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~~-- 465 (532)
.. ..|||||||++|+++ ++.+.+.+++..... +..++|+.+|.+|.++
T Consensus 123 ~~-----------------------~~~fNsGv~l~~~~~----~~~~~~~~~~~~~~~---~~~~DQdiLN~~~~~~~~ 172 (240)
T cd02537 123 GW-----------------------PDLFNSGVFVLKPSE----ETFNDLLDALQDTPS---FDGGDQGLLNSYFSDRGI 172 (240)
T ss_pred Cc-----------------------cccccceEEEEcCCH----HHHHHHHHHHhccCC---CCCCCHHHHHHHHcCCCC
Confidence 20 358999999999964 455556666654432 4557899999999999
Q ss_pred eeecCCccccccCCCCCCc--hhhcCCCeEEEccCCCCCcccCCCC---------CCHHHHHHHH
Q 009572 466 TEPLNPAWHVLGLGYTNVD--PQLIEKGAVLHYNGNSKPWLKIGME---------KYKPLWEKYV 519 (532)
Q Consensus 466 i~~L~~~WN~~~lgy~~~~--~~~~~~~~IIHy~G~~KPW~~~~~~---------~y~~~W~kY~ 519 (532)
+..||.+||++...+.... ....++|+||||+|+.|||...+.. .....||..+
T Consensus 173 ~~~l~~~yN~~~~~~~~~~~~~~~~~~~~iiHf~g~~KPW~~~~~~~~~~~~~~~~~~~~w~~~~ 237 (240)
T cd02537 173 WKRLPFTYNALKPLRYLHPEALWFGDEIKVVHFIGGDKPWSWWRDPETKEKDDYNELHQWWWDIY 237 (240)
T ss_pred EeECCcceeeehhhhccCchhhcccCCcEEEEEeCCCCCCCCCcCCCcccccchHHHHHHHHHHH
Confidence 9999999999854333111 2345689999999999999877543 2456677654
No 20
>PLN00176 galactinol synthase
Probab=99.91 E-value=2.6e-23 Score=215.53 Aligned_cols=233 Identities=18% Similarity=0.266 Sum_probs=147.4
Q ss_pred CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccccCcceee
Q 009572 236 ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQDSETQSYY 315 (532)
Q Consensus 236 vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~~~~~~~~ 315 (532)
+.++.|+.+|+..+... .++++ ++|++++.+..+.+-. .++ .|..++.+. | .
T Consensus 36 ~~Ga~vL~~SLr~~~s~-~~lVv-lVt~dVp~e~r~~L~~----~g~--~V~~V~~i~-------~-------~------ 87 (333)
T PLN00176 36 VKGVVGLAKGLRKVKSA-YPLVV-AVLPDVPEEHRRILVS----QGC--IVREIEPVY-------P-------P------ 87 (333)
T ss_pred HHHHHHHHHHHHHhCCC-CCEEE-EECCCCCHHHHHHHHH----cCC--EEEEecccC-------C-------c------
Confidence 78999999999876432 23333 3467888876554321 122 233333210 0 0
Q ss_pred ecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchhhh--h
Q 009572 316 FSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMETFH--R 393 (532)
Q Consensus 316 F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~~~--~ 393 (532)
.+. .. +..+.+ ..+|.||.++++. +++||||||+|+||.++|++||+++ +..+|||.||.+... .
T Consensus 88 --~~~----~~--~~~~~~--~i~~tKl~iw~l~-~ydkvlyLDaD~lv~~nid~Lf~~~--~~~~aAV~dc~~~~~~~~ 154 (333)
T PLN00176 88 --ENQ----TQ--FAMAYY--VINYSKLRIWEFV-EYSKMIYLDGDIQVFENIDHLFDLP--DGYFYAVMDCFCEKTWSH 154 (333)
T ss_pred --ccc----cc--cccchh--hhhhhhhhhcccc-ccceEEEecCCEEeecChHHHhcCC--CcceEEEecccccccccc
Confidence 000 00 001111 2467799999977 4899999999999999999999873 446899999864311 1
Q ss_pred hhc-----------ccCCCCccccccCC-CCCCccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhh
Q 009572 394 YHK-----------YLNYSHPLIREHFD-PDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLT 461 (532)
Q Consensus 394 ~~~-----------~ln~s~p~i~~~~~-~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~ 461 (532)
+.. .+++ | . .+. +...||||||||||++.|+.+++.+ +++.++. ...++|+.+|.+
T Consensus 155 ~p~~~~~~c~~~~~~~~w--p--~-~~g~~~~~yFNSGVlvinps~~~~~~ll~----~l~~~~~---~~f~DQD~LN~~ 222 (333)
T PLN00176 155 TPQYKIGYCQQCPDKVTW--P--A-ELGPPPPLYFNAGMFVFEPSLSTYEDLLE----TLKITPP---TPFAEQDFLNMF 222 (333)
T ss_pred cccccccccccchhhccc--h--h-hccCCCCCeEEeEEEEEEcCHHHHHHHHH----HHHhcCC---CCCCCHHHHHHH
Confidence 000 1111 1 0 011 2357999999999999999877665 3433332 234788999999
Q ss_pred ccCceeecCCccccccC-CCCCCchhhcCCCeEEEccC-CCCCcccCCCCC---------CHHHHHHHHhc
Q 009572 462 FYGLTEPLNPAWHVLGL-GYTNVDPQLIEKGAVLHYNG-NSKPWLKIGMEK---------YKPLWEKYVDY 521 (532)
Q Consensus 462 F~~~i~~L~~~WN~~~l-gy~~~~~~~~~~~~IIHy~G-~~KPW~~~~~~~---------y~~~W~kY~~~ 521 (532)
|.|++.+||..||++.. .+..-.....++++||||+| ..|||+..+.+. +.+.||..++.
T Consensus 223 F~~~~~~Lp~~YN~~~~~~~~~~~~~~~~~vkIIHY~~~~~KPW~~~~~~~~~~~~~~~~~~~~Ww~~~~~ 293 (333)
T PLN00176 223 FRDIYKPIPPVYNLVLAMLWRHPENVELDKVKVVHYCAAGSKPWRYTGKEENMDREDIKMLVKKWWDIYND 293 (333)
T ss_pred HcCcEEECCchhcCchhhhhhChhhcccCCcEEEEeeCCCCCCCCCCCcccCCChHHHHHHHHHHHHHhcc
Confidence 99999999999999842 12211112256899999997 589998765322 34678886554
No 21
>cd06914 GT8_GNT1 GNT1 is a fungal enzyme that belongs to the GT 8 family. N-acetylglucosaminyltransferase is a fungal enzyme that catalyzes the addition of N-acetyl-D-glucosamine to mannotetraose side chains by an alpha 1-2 linkage during the synthesis of mannan. The N-acetyl-D-glucosamine moiety in mannan plays a role in the attachment of mannan to asparagine residues in proteins. The mannotetraose and its N-acetyl-D-glucosamine derivative side chains of mannan are the principle immunochemical determinants on the cell surface. N-acetylglucosaminyltransferase is a member of glycosyltransferase family 8, which are, based on the relative anomeric stereochemistry of the substrate and product in the reaction catalyzed, retaining glycosyltransferases.
Probab=99.73 E-value=8e-18 Score=171.06 Aligned_cols=140 Identities=12% Similarity=0.155 Sum_probs=108.1
Q ss_pred cchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchhhhhhhcccCCCCccccccCCCCC
Q 009572 334 YLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMETFHRYHKYLNYSHPLIREHFDPDA 413 (532)
Q Consensus 334 ~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~ 413 (532)
.++. +|.||.++++ ++++||||||+|+||.++|++||+++.. ..+||+. . .
T Consensus 76 ~~~~-~~tKl~~~~l-~~y~kvlyLDaD~l~~~~ideLf~~~~~-~~~Aap~-~-------------------------~ 126 (278)
T cd06914 76 YWAK-SLTKLRAFNQ-TEYDRIIYFDSDSIIRHPMDELFFLPNY-IKFAAPR-A-------------------------Y 126 (278)
T ss_pred cHHH-HHHHHHhccc-cceeeEEEecCChhhhcChHHHhcCCcc-cceeeec-C-------------------------c
Confidence 4544 4999999999 6799999999999999999999998733 3345532 1 1
Q ss_pred CccccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccCc-------eeecCCc-cccccCCCCC---
Q 009572 414 CGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYGL-------TEPLNPA-WHVLGLGYTN--- 482 (532)
Q Consensus 414 ~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~~-------i~~L~~~-WN~~~lgy~~--- 482 (532)
.||||||||||+++|+.+++++++......+. ...+|+++|.+|.|. +..||.+ ||++...+..
T Consensus 127 ~~FNSGvmvi~ps~~~~~~l~~~~~~~~~~~~-----~~~DQdiLN~~~~~~~~~~~~~~~~Lp~~~y~llt~~~r~~~~ 201 (278)
T cd06914 127 WKFASHLMVIKPSKEAFKELMTEILPAYLNKK-----NEYDMDLINEEFYNSKQLFKPSVLVLPHRQYGLLTGEFREKLH 201 (278)
T ss_pred ceecceeEEEeCCHHHHHHHHHHHHHhcccCC-----CCCChHHHHHHHhCCccccCcceEEcCccccccCChhhcccCH
Confidence 17999999999999999999999987653222 345778889999999 9999987 9998532221
Q ss_pred -------------Cc-hhhcCCCeEEEccCC--CCCcccCC
Q 009572 483 -------------VD-PQLIEKGAVLHYNGN--SKPWLKIG 507 (532)
Q Consensus 483 -------------~~-~~~~~~~~IIHy~G~--~KPW~~~~ 507 (532)
.+ .+..+++++|||++. .|||....
T Consensus 202 ~~~l~~~~~~~~~w~~~~~~~~~k~vHFSd~Pl~KPW~~~~ 242 (278)
T cd06914 202 KSFLSNAQHLYEKWDPDDVFKESKVIHFSDSPLPKPWNYNN 242 (278)
T ss_pred HHhhccccccccccCHHHHHhhCeEEEecCCCCCCCcCCcC
Confidence 11 134578999999986 69998764
No 22
>KOG1879 consensus UDP-glucose:glycoprotein glucosyltransferase [Carbohydrate transport and metabolism]
Probab=99.26 E-value=7.6e-12 Score=143.75 Aligned_cols=255 Identities=18% Similarity=0.281 Sum_probs=173.8
Q ss_pred cCCCceeEEEEeCC---CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhcccc
Q 009572 222 TDNNLYHFCVFSDN---ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNAS 298 (532)
Q Consensus 222 ~d~~~~hIa~~sDn---vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~ 298 (532)
.|...|||.-..-. -+.+-++|.|+++|++.| +.|+++-+-+|..-....=..+.-.+..+++.+.+==.|
T Consensus 1177 ~~~~vINIFSvASGHLYERflrIMm~SvlknTktp--VKFWfLkNyLSPtFKe~iP~mA~eYnFeyElv~YkWPrW---- 1250 (1470)
T KOG1879|consen 1177 KDKEVINIFSVASGHLYERFLRIMMLSVLKNTKTP--VKFWFLKNYLSPTFKESIPHMAKEYNFEYELVQYKWPRW---- 1250 (1470)
T ss_pred CccceEEEEeeccccHHHHHHHHHHHHHHhCCCCc--eeEEeehhhcChHHHHHHHHHHHHhCceEEEEEecCchh----
Confidence 34447888754443 367889999999999997 999999998877544333222233344555543322223
Q ss_pred ccchhhhccccCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCC-CCeEEEEecceeeccCchHHhccCCC
Q 009572 299 YVPVLKQLQDSETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPA-LKKVVFLDDDVVVQKDLSALFSINLN 377 (532)
Q Consensus 299 y~p~l~ql~~~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~-ldKVLYLD~DvIV~~DLseLw~iDL~ 377 (532)
|.|-.. .. | -+-.|--+||.-+||- ++||||.|+|-||..||.||.+.|++
T Consensus 1251 ----LhqQ~E-------------KQ------R-----iiWgyKILFLDVLFPL~v~KvIfVDADQIVR~DL~EL~dfdl~ 1302 (1470)
T KOG1879|consen 1251 ----LHQQTE-------------KQ------R-----IIWGYKILFLDVLFPLNVDKVIFVDADQIVRADLKELMDFDLG 1302 (1470)
T ss_pred ----hhhhhh-------------hh------h-----hhhhhhhhhhhhccccccceEEEEcchHhhhhhhHHHHhcccC
Confidence 322110 00 1 1245667789899996 99999999999999999999999999
Q ss_pred CCeeEeeeccchhhhhhhcccCCCCccccccCCCCCCccccceeeeechHHHHhhHHHHHH-HHHHhcCCc-ccccC-CC
Q 009572 378 GNVNGAVETCMETFHRYHKYLNYSHPLIREHFDPDACGWAFGMNIFDLVEWRKRNVTGIYH-YWQEKNVDR-TLWKL-GT 454 (532)
Q Consensus 378 g~~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~~~~-~~~~~~~d~-~l~~~-~~ 454 (532)
|.+.|-++.|..+ ....+|-.|+...+++-+ .+..|..|...|+||++.|+..-..++. .|+....|- .+-+. ++
T Consensus 1303 GaPygYtPfCdsR-~EMDGyRFWK~GYW~~hL-~grkYHISALYVVDLkrFReiaAGDrLR~qYQ~LS~DPNSLsNLDQD 1380 (1470)
T KOG1879|consen 1303 GAPYGYTPFCDSR-REMDGYRFWKQGYWKKHL-RGRKYHISALYVVDLKRFREIAAGDRLRGQYQALSQDPNSLSNLDQD 1380 (1470)
T ss_pred CCccccCcccccc-ccccchhHHhhhHHHHHh-ccCccccceeeeeeHHHHHhcccchHHHHHHHhhcCCcchhhhcccc
Confidence 9999999999742 223334444444444433 3477999999999999999999998887 677665554 34443 56
Q ss_pred CChhhhhccCceeecCCccccccCCCCCCchhhcCCCeEEEccCCCCCcccCC----CCCCHHHHHHH
Q 009572 455 LPPGLLTFYGLTEPLNPAWHVLGLGYTNVDPQLIEKGAVLHYNGNSKPWLKIG----MEKYKPLWEKY 518 (532)
Q Consensus 455 L~~~n~~F~~~i~~L~~~WN~~~lgy~~~~~~~~~~~~IIHy~G~~KPW~~~~----~~~y~~~W~kY 518 (532)
||. |+.-.--|+.||..|-++..+.+ .+..+.+++|--|.+ ||.... .......|..|
T Consensus 1381 LPN-nm~hqVpIkSLPqeWLWCETWC~---d~skkkAktIDLCnN--P~TKEpKL~~A~Riv~EW~dy 1442 (1470)
T KOG1879|consen 1381 LPN-NMQHQVPIKSLPQEWLWCETWCD---DESKKKAKTIDLCNN--PLTKEPKLDAARRIVSEWTDY 1442 (1470)
T ss_pred ccc-cceeecccccCCcchhhhhhhcC---chhhhhchhhhhhcC--ccccchhhHHHhhhcCCCccc
Confidence 763 45666688999999988765433 445678899998875 886651 22334455554
No 23
>COG5597 Alpha-N-acetylglucosamine transferase [Cell envelope biogenesis, outer membrane]
Probab=97.43 E-value=0.0001 Score=75.55 Aligned_cols=94 Identities=20% Similarity=0.253 Sum_probs=56.4
Q ss_pred hhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccch---hhhh---------------h------
Q 009572 339 NHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCME---TFHR---------------Y------ 394 (532)
Q Consensus 339 ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~---~~~~---------------~------ 394 (532)
++.++-+-+... +|||+|||+|.||.+++++||... -+-.+|.+|... .|++ |
T Consensus 156 mftKLrVfeqtE-yDRvifLDsDaivlknmDklFd~P--vyef~a~pD~~~sp~~fhrp~~~i~~~ft~~faayg~~r~~ 232 (368)
T COG5597 156 MFTKLRVFEQTE-YDRVIFLDSDAIVLKNMDKLFDYP--VYEFAAAPDVYESPADFHRPNSGIFVSFTPAFAAYGKMRAA 232 (368)
T ss_pred HhHHHHhhhhhh-hceEEEeccchHHhhhhHHHhcch--hhhhccCCchhhCHHHhcCCCCccceeecHHHHhhcccHhh
Confidence 344555445543 899999999999999999999764 334455454321 1221 1
Q ss_pred --hcccCCC--Ccc-ccccCCCCCCccccceeeeechHHHHhhHHH
Q 009572 395 --HKYLNYS--HPL-IREHFDPDACGWAFGMNIFDLVEWRKRNVTG 435 (532)
Q Consensus 395 --~~~ln~s--~p~-i~~~~~~~~~yfNsGVlLiNL~~wR~~nit~ 435 (532)
..|+++. .+. +.+..+.-..+||||.||++..+..-..+..
T Consensus 233 ly~Pylf~a~~dq~~~hstpP~fk~~FnagLmv~~Psk~hm~riv~ 278 (368)
T COG5597 233 LYAPYLFWARTDQTFLHSTPPDFKLKFNAGLMVGLPSKMHMLRIVW 278 (368)
T ss_pred hccccccccccCCcccccCCCcHhhhhccCceeecchHHHHHHHHH
Confidence 1233321 111 1112233356899999999999876555444
No 24
>PLN03182 xyloglucan 6-xylosyltransferase; Provisional
Probab=93.43 E-value=0.31 Score=52.48 Aligned_cols=160 Identities=16% Similarity=0.198 Sum_probs=84.9
Q ss_pred CCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhccCCCCC--eeEeeeccchhhhhhhcccCCCCccccccC
Q 009572 332 PKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGN--VNGAVETCMETFHRYHKYLNYSHPLIREHF 409 (532)
Q Consensus 332 ~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~--~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~ 409 (532)
+.+|+..-+.|=.+- -.|+++-+.|||+|.||..-- +++.++.+ ....+. .+...+ -.
T Consensus 179 p~~WaKlpaLR~aM~-~~PeaEWiWWLDsDALImNms---felPlery~~~NlVih-------g~~~~l---------~~ 238 (429)
T PLN03182 179 AGFWAKLPLLRKLML-AHPEVEWIWWMDSDALFTDMT---FEIPLEKYEGYNLVIH-------GWDELV---------YD 238 (429)
T ss_pred CcchhHHHHHHHHHH-HCCCceEEEEecCCceeecCC---CCCCHhHcCCcCeeec-------cchhhh---------ee
Confidence 356766666665443 368999999999999998631 12222211 111111 010000 01
Q ss_pred CCCCCccccceeeeechHHHHhhHHHHHHHHHHhc-----------------CCcccccCCCCChhhhhc------cCce
Q 009572 410 DPDACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKN-----------------VDRTLWKLGTLPPGLLTF------YGLT 466 (532)
Q Consensus 410 ~~~~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~-----------------~d~~l~~~~~L~~~n~~F------~~~i 466 (532)
.++-.+.|+|+++|--..|--.-+. .|.... .++..+..++|.++-.++ .+.-
T Consensus 239 ~kdW~GLNtGsFLIRNcqWSldlLD----aWa~mgp~~~~~~~~g~~l~~~l~~rp~~eaDDQSAlvyLl~~~~~~w~~k 314 (429)
T PLN03182 239 QKSWIGLNTGSFLIRNCQWSLDLLD----AWAPMGPKGPIRDEAGKILTAELKGRPAFEADDQSALVYLLLTQRERWGDK 314 (429)
T ss_pred ccccCccceeeEEEEcCHHHHHHHH----HHHhcCCCCchhhhHHHHHHHhhcCCCCCCcccHHHHHHHHHhcchhhccc
Confidence 2345689999999987777643221 232222 244556667776654333 1123
Q ss_pred eecCCccccccCC------CCCCc------hhhcCCCeEEEccCCCCCcccCCCCCCHHHHH
Q 009572 467 EPLNPAWHVLGLG------YTNVD------PQLIEKGAVLHYNGNSKPWLKIGMEKYKPLWE 516 (532)
Q Consensus 467 ~~L~~~WN~~~lg------y~~~~------~~~~~~~~IIHy~G~~KPW~~~~~~~y~~~W~ 516 (532)
.+|...|-+.|.. |++.. .....-|-|.||+| .||....+..+-..-|.
T Consensus 315 v~le~~y~l~Gyw~~iv~~yee~~~~~~~g~gd~rwPfvtHF~G-ckpC~~~~~y~~~~C~~ 375 (429)
T PLN03182 315 VYLENSYYLHGYWVGLVDRYEEMMEKYHPGLGDDRWPFVTHFVG-CKPCGGYGDYPVERCLK 375 (429)
T ss_pred eEEeecceeccccHHHHHHHHHHHHhcCCCCCCcccceeEeecc-ceecCCCCCcCHHHHHH
Confidence 4466665554421 21110 01234589999999 89996655323334443
No 25
>PF03407 Nucleotid_trans: Nucleotide-diphospho-sugar transferase; InterPro: IPR005069 Proteins in this family have been been predicted to be nucleotide-diphospho-sugar transferases [].
Probab=93.21 E-value=0.18 Score=48.94 Aligned_cols=141 Identities=17% Similarity=0.117 Sum_probs=73.7
Q ss_pred cchhhhhHHHh-hhhhcCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccchhhhhhhcccCCCCccccccCCCC
Q 009572 334 YLSMLNHLRFY-IPEVFPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCMETFHRYHKYLNYSHPLIREHFDPD 412 (532)
Q Consensus 334 ~lS~~ty~Rf~-lPellP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~~~~~~~~~ln~s~p~i~~~~~~~ 412 (532)
.+..++..|.- +-+++..=--|+|+|+|++..+|..+++ +-.+.-+.+..|+..... ....
T Consensus 47 ~~~~~~~~K~~~~~~~L~~G~~vl~~D~Dvv~~~dp~~~~--~~~~~Di~~~~d~~~~~~----------------~~~~ 108 (212)
T PF03407_consen 47 AFQKLTWLKPKVLLDLLELGYDVLFSDADVVWLRDPLPYF--ENPDADILFSSDGWDGTN----------------SDRN 108 (212)
T ss_pred HHHHHHHHHHHHHHHHHHcCCceEEecCCEEEecCcHHhh--ccCCCceEEecCCCcccc----------------hhhc
Confidence 34445556654 4456654236999999999999999999 223444444446542100 1112
Q ss_pred CCccccceeeeechHHHHhhHHHHHHHHHHhcCCc-ccccCCCCChhhhhccC--------ceeecCCccccccCCCC-C
Q 009572 413 ACGWAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDR-TLWKLGTLPPGLLTFYG--------LTEPLNPAWHVLGLGYT-N 482 (532)
Q Consensus 413 ~~yfNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~-~l~~~~~L~~~n~~F~~--------~i~~L~~~WN~~~lgy~-~ 482 (532)
...+|+|++.+--+.-- ..-+..|.+...+. ..+ +|.+++.++.. ++..||..--..+.+|- .
T Consensus 109 ~~~~n~G~~~~r~t~~~----~~~~~~w~~~~~~~~~~~---DQ~~~n~~l~~~~~~~~~~~~~~L~~~~f~~g~~~f~~ 181 (212)
T PF03407_consen 109 GNLVNTGFYYFRPTPRT----IAFLEDWLERMAESPGCW---DQQAFNELLREQAARYGGLRVRFLPPSLFPNGHGYFCQ 181 (212)
T ss_pred CCccccceEEEecCHHH----HHHHHHHHHHHHhCCCcc---hHHHHHHHHHhcccCCcCcEEEEeCHHHeeccccceee
Confidence 33469999998665322 22233454332211 223 44455544433 34556654433332222 1
Q ss_pred -C-chhh--cCCCeEEEccCC
Q 009572 483 -V-DPQL--IEKGAVLHYNGN 499 (532)
Q Consensus 483 -~-~~~~--~~~~~IIHy~G~ 499 (532)
. .... ...|.+||.++.
T Consensus 182 ~~~~~~~~~~~~p~~vH~n~~ 202 (212)
T PF03407_consen 182 SRDWAWVPTKNKPYIVHANCC 202 (212)
T ss_pred cchhhhhccccccceEEEcCC
Confidence 0 1111 357999999863
No 26
>PF11051 Mannosyl_trans3: Mannosyltransferase putative; InterPro: IPR022751 Alpha-mannosyltransferase is responsible for the addition of residues to the outer chain of core N-linked polysaccharides and to O-linked mannotriose. It is implicated in late Golgi modifications [][][]. The proteins matching this entry are conserved in fungi and also found in some phototrophic organisms.; GO: 0006486 protein glycosylation
Probab=81.38 E-value=4.5 Score=41.38 Aligned_cols=32 Identities=28% Similarity=0.501 Sum_probs=27.4
Q ss_pred hhhhhcCCCCeEEEEecceeeccCchHHhccC
Q 009572 344 YIPEVFPALKKVVFLDDDVVVQKDLSALFSIN 375 (532)
Q Consensus 344 ~lPellP~ldKVLYLD~DvIV~~DLseLw~iD 375 (532)
.++-++...+.||+||+|.|...|.+.||+.+
T Consensus 83 ~lA~l~ssFeevllLDaD~vpl~~p~~lF~~~ 114 (271)
T PF11051_consen 83 WLALLFSSFEEVLLLDADNVPLVDPEKLFESE 114 (271)
T ss_pred hhhhhhCCcceEEEEcCCcccccCHHHHhcCc
Confidence 44556777999999999999999999999753
No 27
>PLN03181 glycosyltransferase; Provisional
Probab=78.06 E-value=3.5 Score=44.77 Aligned_cols=35 Identities=20% Similarity=0.285 Sum_probs=24.9
Q ss_pred CCcchhhhhHHHhhhhhcCCCCeEEEEecceeeccC
Q 009572 332 PKYLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKD 367 (532)
Q Consensus 332 ~~~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~D 367 (532)
+..++..-..|=.+ .-+|+.+-+.|||.|+||...
T Consensus 180 p~~WaKipalRaAM-~a~PeAEWfWWLDsDALIMNp 214 (453)
T PLN03181 180 NSYWAKLPVVRAAM-LAHPEAEWIWWVDSDAVFTDM 214 (453)
T ss_pred chhhhHHHHHHHHH-HHCCCceEEEEecCCceeecC
Confidence 34565555555333 238999999999999999865
No 28
>PF10819 DUF2564: Protein of unknown function (DUF2564) ; InterPro: IPR020314 This entry contains proteins with no known function.
Probab=70.47 E-value=21 Score=30.06 Aligned_cols=71 Identities=15% Similarity=0.226 Sum_probs=54.8
Q ss_pred HHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccc--cChHHHHHHHHHHHHhHHHHhhhhh
Q 009572 102 WELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFH--YDSATMIMRLKAKIQGLEEQMGSVN 173 (532)
Q Consensus 102 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~~~kl~~~~~~~e~~~~~~~ 173 (532)
+++.-.|+.-|+++|.||++-++-....|...|+....-+..|++.. .|- .+...=.+.|+..|-|+..++
T Consensus 6 kQve~aVetAqkmvG~AT~smdp~~Le~A~qAve~Ar~ql~~a~~~at~lD~-~Fl~~~~~~L~~~eHQL~Eak 78 (79)
T PF10819_consen 6 KQVEMAVETAQKMVGQATMSMDPDQLEHATQAVEDAREQLSQAKSHATGLDE-PFLQQSEQLLDDCEHQLDEAK 78 (79)
T ss_pred HHHHHHHHHHHHHHHHHHhcCCHHHHHHHHHHHHHHHHHHHHHHHHHhCCcH-HHHHHHHHHHHHHHHHHHHhc
Confidence 56778899999999999998776556788888888888888887655 443 566667778888888877654
No 29
>PF05637 Glyco_transf_34: galactosyl transferase GMA12/MNN10 family; InterPro: IPR008630 This family contains a number of glycosyltransferase enzymes that contain a DXD motif. This family includes a number of Caenorhabditis elegans homologues where the DXD is replaced by DXH. Some members of this family are included in glycosyltransferase family 34.; GO: 0016758 transferase activity, transferring hexosyl groups, 0016021 integral to membrane; PDB: 2P72_B 2P73_A 2P6W_A.
Probab=70.35 E-value=2.8 Score=42.16 Aligned_cols=24 Identities=25% Similarity=0.362 Sum_probs=12.6
Q ss_pred cCCCCeEEEEecceeeccCchHHh
Q 009572 349 FPALKKVVFLDDDVVVQKDLSALF 372 (532)
Q Consensus 349 lP~ldKVLYLD~DvIV~~DLseLw 372 (532)
+|+++-|+|||+|.+|...=-+|-
T Consensus 74 ~P~~~wv~~lD~Dali~n~~~~L~ 97 (239)
T PF05637_consen 74 YPEAEWVWWLDSDALIMNPDFSLE 97 (239)
T ss_dssp -TT-SEEEEE-TTEEE--------
T ss_pred CCCCCEEEEEcCCeEEEecccccc
Confidence 388999999999999986544443
No 30
>PF03071 GNT-I: GNT-I family; InterPro: IPR004139 The biosynthesis of disaccharides, oligosaccharides and polysaccharides involves the action of hundreds of different glycosyltransferases. These enzymes catalyse the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. A classification of glycosyltransferases using nucleotide diphospho-sugar, nucleotide monophospho-sugar and sugar phosphates (2.4.1.- from EC) and related proteins into distinct sequence based families has been described []. This classification is available on the CAZy (CArbohydrate-Active EnZymes) web site. The same three-dimensional fold is expected to occur within each of the families. Because 3-D structures are better conserved than sequences, several of the families defined on the basis of sequence similarities may have similar 3-D structures and therefore form 'clans'. Alpha-1,3-mannosyl-glycoprotein beta-1,2-N-acetylglucosaminyltransferase (GNT-I, GLCNAC-T I) 2.4.1.101 from EC transfers N-acetyl-D-glucosamine from UDP to high-mannose glycoprotein N-oligosaccharide. This is an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. The enzyme is an integral membrane protein localized to the Golgi apparatus, and is probably distributed in all tissues. The catalytic domain is located at the C terminus []. These proteins are members of the glycosyl transferase family 13 (GH13 from CAZY); GO: 0003827 alpha-1,3-mannosylglycoprotein 2-beta-N-acetylglucosaminyltransferase activity, 0006487 protein N-linked glycosylation, 0000139 Golgi membrane; PDB: 2APC_A 2AM4_A 1FO9_A 2AM3_A 1FOA_A 2AM5_A 1FO8_A.
Probab=69.70 E-value=10 Score=41.59 Aligned_cols=115 Identities=16% Similarity=0.245 Sum_probs=64.7
Q ss_pred EEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccc
Q 009572 229 FCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQD 308 (532)
Q Consensus 229 Ia~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~ 308 (532)
++++|+...++.-+|.|++++....+.+.+.|--|+-+.+..+..- .+.+ .++ .++..+ ..+.
T Consensus 98 lV~AcNRp~yl~r~L~sLl~~rp~~~~fpIiVSQDg~~~~~~~vi~---~y~~-~v~--~i~~~~-----~~~i------ 160 (434)
T PF03071_consen 98 LVFACNRPDYLRRTLDSLLKYRPSAEKFPIIVSQDGDDEEVAEVIK---SYGD-QVT--YIQHPD-----FSPI------ 160 (434)
T ss_dssp EEEESS-TT-HHHHHHHHHHH-S-TTTS-EEEEE-TT-HHHHHHHH---GGGG-GSE--EEE-S-------S--------
T ss_pred EEEecCCcHHHHHHHHHHHHcCCCCCCccEEEEecCCcHHHHHHHH---Hhhh-hhe--eeecCC-----cCCc------
Confidence 4577777999999999999987665567677777776665543321 1111 111 111100 0000
Q ss_pred cCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCC--CCeEEEEecceeeccCchHHhcc
Q 009572 309 SETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPA--LKKVVFLDDDVVVQKDLSALFSI 374 (532)
Q Consensus 309 ~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~--ldKVLYLD~DvIV~~DLseLw~i 374 (532)
..... .-++ ..|..++.|++.-|-.+|.. +++||.|.+|+.|--|+-+-|+-
T Consensus 161 ----------~~~~~--~~~~--~~y~~IA~HYk~aL~~vF~~~~~~~vIIlEDDL~isPDFf~Yf~~ 214 (434)
T PF03071_consen 161 ----------TIPPK--EKKF--KGYYKIARHYKWALSQVFNKFKYSSVIILEDDLEISPDFFEYFSA 214 (434)
T ss_dssp -------------TT---GGG--HHHHHHHHHHHHHHHHHHHTS--SEEEEEETTEEE-TTHHHHHHH
T ss_pred ----------eeCcc--cccc--cchHHHHHHHHHHHHHHHHhcCCceEEEEecCcccCccHHHHHHH
Confidence 00000 0011 24677888999999999964 89999999999999998887754
No 31
>COG4575 ElaB Uncharacterized conserved protein [Function unknown]
Probab=68.26 E-value=24 Score=31.24 Aligned_cols=75 Identities=16% Similarity=0.111 Sum_probs=60.1
Q ss_pred hHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccCh-HHHHHHHHHHHHhHHHHhhhhhhcc
Q 009572 98 LQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDS-ATMIMRLKAKIQGLEEQMGSVNEKS 176 (532)
Q Consensus 98 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~kl~~~~~~~e~~~~~~~~~~ 176 (532)
.++.-||+.-+-+.|.+|..+...+. .++.+.=...+.++.+++...-+- ..++.+-++....+|+-++.+-=|+
T Consensus 11 ~~l~~el~~L~d~lEevL~ssg~~a~----~e~~~lR~r~~~~Lk~~r~rl~~~~d~v~~~sk~a~~~tD~yV~e~PWq~ 86 (104)
T COG4575 11 DQLLAELQELLDTLEEVLKSSGSLAG----DEAEELRSKAESALKEARDRLGDTGDAVVQRSKAAADATDDYVRENPWQG 86 (104)
T ss_pred HHHHHHHHHHHHHHHHHHHhcccchh----hHHHHHHHHHHHHHHHHHHHHHhhhhHHHHHHHHHHHHHHHHHHcCCchH
Confidence 67889999999999999998887764 355565566777888887766666 7888999999999999988776554
No 32
>KOG1928 consensus Alpha-1,4-N-acetylglucosaminyltransferase [Carbohydrate transport and metabolism]
Probab=63.82 E-value=3.4 Score=44.35 Aligned_cols=32 Identities=34% Similarity=0.441 Sum_probs=24.4
Q ss_pred hhhHHHhhhhhcCCCCeEEEEecceeeccCchHHhc
Q 009572 338 LNHLRFYIPEVFPALKKVVFLDDDVVVQKDLSALFS 373 (532)
Q Consensus 338 ~ty~Rf~lPellP~ldKVLYLD~DvIV~~DLseLw~ 373 (532)
.+..|+.+=.=+.. ||||+|+||.++++.|=|
T Consensus 228 Sdl~RLA~LyKYGG----vYLDTDvIvLksl~~l~N 259 (409)
T KOG1928|consen 228 SDLSRLALLYKYGG----VYLDTDVIVLKSLSNLRN 259 (409)
T ss_pred HHHHHHHHHHHhCC----EEeeccEEEecccccccc
Confidence 35678775443444 899999999999999864
No 33
>PRK10132 hypothetical protein; Provisional
Probab=63.42 E-value=32 Score=30.67 Aligned_cols=75 Identities=11% Similarity=0.035 Sum_probs=57.4
Q ss_pred hHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhcc
Q 009572 98 LQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKS 176 (532)
Q Consensus 98 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~ 176 (532)
++|..||+.-+.+.|.+|..+...+. .++...=...+..+..+++..-|-..+..+.+.....+++.++.+--++
T Consensus 15 e~L~~Dl~~L~~~le~ll~~~~~~~~----~~~~~lR~r~~~~L~~ar~~l~~~~~~~~~~~~a~~~~~~~V~~~Pw~s 89 (108)
T PRK10132 15 QDIQNDVNQLADSLESVLKSWGSDAK----GEAEAARRKAQALLKETRARMHGRTRVQQAARDAVGCADTFVRERPWCS 89 (108)
T ss_pred HHHHHHHHHHHHHHHHHHHHHhhhhH----HHHHHHHHHHHHHHHHHHHHHhhhHHHHHHHHHHHHHHHHHHHhCcHHH
Confidence 68999999999999999987776653 2455556667778888877666666777778888889988887765554
No 34
>cd02514 GT13_GLCNAC-TI GT13_GLCNAC-TI is involved in an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. Alpha-1,3-mannosyl-glycoprotein beta-1,2-N-acetylglucosaminyltransferase (GLCNAC-T I , GNT-I) transfers N-acetyl-D-glucosamine from UDP to high-mannose glycoprotein N-oligosaccharide, an essential step in the synthesis of complex or hybrid-type N-linked oligosaccharides. The enzyme is an integral membrane protein localized to the Golgi apparatus. The catalytic domain is located at the C-terminus. These proteins are members of the glycosy transferase family 13.
Probab=62.06 E-value=28 Score=36.97 Aligned_cols=113 Identities=15% Similarity=0.181 Sum_probs=67.4
Q ss_pred EEEEeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHHHhccCCCceEEEeeeccchhccccccchhhhccc
Q 009572 229 FCVFSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWFAINSFRGVTVEVQKFEDFKWLNASYVPVLKQLQD 308 (532)
Q Consensus 229 Ia~~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf~~n~~~~a~I~v~~i~~f~wl~~~y~p~l~ql~~ 308 (532)
++++++..-++.-+|.|++++.+..+...++|..|+-..+....... .. ..|. .+.+ ..
T Consensus 5 lv~ayNRp~~l~r~LesLl~~~p~~~~~~liIs~DG~~~~~~~~v~~---~~-~~i~--~i~~--------------~~- 63 (334)
T cd02514 5 LVIACNRPDYLRRMLDSLLSYRPSAEKFPIIVSQDGGYEEVADVAKS---FG-DGVT--HIQH--------------PP- 63 (334)
T ss_pred EEEecCCHHHHHHHHHHHHhccccCCCceEEEEeCCCchHHHHHHHh---hc-cccE--EEEc--------------cc-
Confidence 34555667789999999999853434689999999976654432211 11 0111 1110 00
Q ss_pred cCcceeeecCCCCCCCCCcccCCCCcchhhhhHHHhhhhhcCC--CCeEEEEecceeeccCchHHhc
Q 009572 309 SETQSYYFSGNSDGGRTPIKFRNPKYLSMLNHLRFYIPEVFPA--LKKVVFLDDDVVVQKDLSALFS 373 (532)
Q Consensus 309 ~~~~~~~F~~~~~~~~~~lk~r~~~~lS~~ty~Rf~lPellP~--ldKVLYLD~DvIV~~DLseLw~ 373 (532)
+.. ...+ .+.+ ...|.+++.+++.-+-.+|-. +++||.||+|+++.-|.-+.++
T Consensus 64 -------~~~-~~~~-~~~~--~~~y~~ia~hyk~aln~vF~~~~~~~vIILEDDl~~sPdFf~yf~ 119 (334)
T cd02514 64 -------ISI-KNVN-PPHK--FQGYYRIARHYKWALTQTFNLFGYSFVIILEDDLDIAPDFFSYFQ 119 (334)
T ss_pred -------ccc-cccC-cccc--cchhhHHHHHHHHHHHHHHHhcCCCEEEEECCCCccCHhHHHHHH
Confidence 000 0000 0001 124566777777888888865 8999999999999999665554
No 35
>PRK05529 cell division protein FtsQ; Provisional
Probab=57.76 E-value=7.6 Score=39.53 Aligned_cols=12 Identities=8% Similarity=0.019 Sum_probs=6.4
Q ss_pred cceeeccCchHH
Q 009572 360 DDVVVQKDLSAL 371 (532)
Q Consensus 360 ~DvIV~~DLseL 371 (532)
.-+|+-||.+.+
T Consensus 213 G~~V~~G~~~~~ 224 (255)
T PRK05529 213 GKTVFWGSFENS 224 (255)
T ss_pred CEEEEeCCcchH
Confidence 334446666654
No 36
>PF04488 Gly_transf_sug: Glycosyltransferase sugar-binding region containing DXD motif ; InterPro: IPR007577 This entry represents those sugar-binding regions of glycosyltransferases that contain a DXD motif. The DXD motif is a short conserved motif found in many families of glycosyltransferases, which add a range of different sugars to other sugars, phosphates and proteins. DXD-containing glycosyltransferases all use nucleoside diphosphate sugars as donors and require divalent cations, usually manganese. The DXD motif is expected to play a carbohydrate binding role in sugar-nucleoside diphosphate and manganese dependent glycosyltransferases [].
Probab=56.82 E-value=8.8 Score=33.13 Aligned_cols=35 Identities=23% Similarity=0.458 Sum_probs=28.9
Q ss_pred cchhhhhHHHhhhhhcCCCCeEEEEecceeeccCc-hHHh
Q 009572 334 YLSMLNHLRFYIPEVFPALKKVVFLDDDVVVQKDL-SALF 372 (532)
Q Consensus 334 ~lS~~ty~Rf~lPellP~ldKVLYLD~DvIV~~DL-seLw 372 (532)
+...+.++|+.+--.... ||+|.|+++.+++ +++-
T Consensus 62 ~~~~sD~~R~~~L~~~GG----iY~D~D~~~~rpl~~~~~ 97 (103)
T PF04488_consen 62 YAHKSDLLRYLVLYKYGG----IYLDLDVICLRPLDDPWL 97 (103)
T ss_pred hHHHHHHHHHHHHHHcCc----EEEeCccccCcchhhhhh
Confidence 445677899998888877 9999999999999 6543
No 37
>KOG1950 consensus Glycosyl transferase, family 8 - glycogenin [Carbohydrate transport and metabolism]
Probab=55.16 E-value=21 Score=38.19 Aligned_cols=148 Identities=15% Similarity=0.089 Sum_probs=74.1
Q ss_pred cCCCCeEEEEecceeeccCchHHhccCCCCCeeEeeeccch-----hhhhhhc-ccCCCCc--cc---cccCC--CCCCc
Q 009572 349 FPALKKVVFLDDDVVVQKDLSALFSINLNGNVNGAVETCME-----TFHRYHK-YLNYSHP--LI---REHFD--PDACG 415 (532)
Q Consensus 349 lP~ldKVLYLD~DvIV~~DLseLw~iDL~g~~iaAV~Dc~~-----~~~~~~~-~ln~s~p--~i---~~~~~--~~~~y 415 (532)
|.+.++++|+|.|+.+..++...+++-.. .-.+...|.. ..-.+.. .....++ .. ..-+. ...+.
T Consensus 122 ~~~~~a~i~~~~~i~~~~~~~~~~~v~~~--~~~~~~~~~~~~~~~~~~~~d~~~~~~~~~~~~f~~~~~~~~~~~l~~~ 199 (369)
T KOG1950|consen 122 LIEDGAAIYLVDDIQRFRNDDANFDVPNE--LNYAKLYMFQLDFYSKLVKIDADDCILKNDDLLFSNWPDLFATNILPLI 199 (369)
T ss_pred eeccCceEEEecchhhccCccccccccch--hcccccceeeecccccceEEeccchhcCChhhhhhhchhhccCCCccce
Confidence 45579999999999999999998866432 2222232221 0001111 1111111 00 01122 23456
Q ss_pred cccceeeeechHHHHhhHHHHHHHHHHhcCCcccccCCCCChhhhhccCceeecCCcccccc-CCCC-----CCchhhcC
Q 009572 416 WAFGMNIFDLVEWRKRNVTGIYHYWQEKNVDRTLWKLGTLPPGLLTFYGLTEPLNPAWHVLG-LGYT-----NVDPQLIE 489 (532)
Q Consensus 416 fNsGVlLiNL~~wR~~nit~~~~~~~~~~~d~~l~~~~~L~~~n~~F~~~i~~L~~~WN~~~-lgy~-----~~~~~~~~ 489 (532)
||+|++++-...-.-.. ++.......-++++++..++..|.....+.|...|..- .... .+......
T Consensus 200 ~n~~~~v~~ps~~~~~~-------~~~~~~~~~~~~~~~q~~l~~~f~~~~~~~~~~~n~~~~~~~~~p~~~~l~~~~~~ 272 (369)
T KOG1950|consen 200 FNSGLLVFEPSLCNYKD-------LMEFSEEFESYNGADQGFLHLIFSWIPDRPPPSVNLNLAKLWRHPKKNDLSRASSV 272 (369)
T ss_pred eccCccccCCCccchhh-------HHHhhcccCCCCCccchhhHHHhhcccCCCcccccccccccccCccccchhhcccc
Confidence 99999998655333222 33222222234455566566666555446676666542 1111 11111122
Q ss_pred CCeEEEccCCCCCccc
Q 009572 490 KGAVLHYNGNSKPWLK 505 (532)
Q Consensus 490 ~~~IIHy~G~~KPW~~ 505 (532)
.-..+||.|..|||..
T Consensus 273 ~~~~~~y~~~~~p~~~ 288 (369)
T KOG1950|consen 273 LRYALHYLGANKPELC 288 (369)
T ss_pred cchhhhccccCCCCcc
Confidence 2345699997677754
No 38
>cd00761 Glyco_tranf_GTA_type Glycosyltransferase family A (GT-A) includes diverse families of glycosyl transferases with a common GT-A type structural fold. Glycosyltransferases (GTs) are enzymes that synthesize oligosaccharides, polysaccharides, and glycoconjugates by transferring the sugar moiety from an activated nucleotide-sugar donor to an acceptor molecule, which may be a growing oligosaccharide, a lipid, or a protein. Based on the stereochemistry of the donor and acceptor molecules, GTs are classified as either retaining or inverting enzymes. To date, all GT structures adopt one of two possible folds, termed GT-A fold and GT-B fold. This hierarchy includes diverse families of glycosyl transferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. The majority of the proteins in this superfamily are Glycosyltransferase family 2 (GT-2) proteins. But it als
Probab=50.79 E-value=1.2e+02 Score=25.41 Aligned_cols=41 Identities=7% Similarity=-0.072 Sum_probs=28.2
Q ss_pred EeCCCccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHHHHH
Q 009572 232 FSDNILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMKAWF 274 (532)
Q Consensus 232 ~sDnvl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~~wf 274 (532)
+.++...+.-++.|+...... ...+.|++++.+.+....+.
T Consensus 5 ~~~~~~~l~~~l~s~~~~~~~--~~~i~i~~~~~~~~~~~~~~ 45 (156)
T cd00761 5 AYNEEPYLERCLESLLAQTYP--NFEVIVVDDGSTDGTLEILE 45 (156)
T ss_pred ecCcHHHHHHHHHHHHhCCcc--ceEEEEEeCCCCccHHHHHH
Confidence 334455567788888887653 58899999987776655443
No 39
>PF06637 PV-1: PV-1 protein (PLVAP); InterPro: IPR009538 This family consists of several PV-1 (PLVAP) proteins, which seem to be specific to mammals. PV-1 is a novel protein component of the endothelial fenestral and stomatal diaphragms []. The function of this family is unknown.
Probab=50.62 E-value=2.8e+02 Score=30.21 Aligned_cols=17 Identities=12% Similarity=0.172 Sum_probs=14.6
Q ss_pred HHHHHHHHHHHhhhccc
Q 009572 25 CGIAVLLFIVILSKESQ 41 (532)
Q Consensus 25 ~~~~~~~~~~~~~~~~~ 41 (532)
+-++.|+|||||++-++
T Consensus 35 IQ~LIIlgLVLFmVYGn 51 (442)
T PF06637_consen 35 IQFLIILGLVLFMVYGN 51 (442)
T ss_pred HHHHHHHHHHHHHhhCC
Confidence 34778999999999988
No 40
>PRK10404 hypothetical protein; Provisional
Probab=44.71 E-value=1.1e+02 Score=26.84 Aligned_cols=78 Identities=6% Similarity=0.006 Sum_probs=53.2
Q ss_pred cCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHH-HHHHHHHHHHhHHHHhhhh
Q 009572 94 ESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSAT-MIMRLKAKIQGLEEQMGSV 172 (532)
Q Consensus 94 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~kl~~~~~~~e~~~~~~ 172 (532)
..+.+++..||+.-+.+.|.++..+..++. ..+...=...+..+..++...-|-.. +..+.++....+++-++.+
T Consensus 4 ~~~~~~l~~dl~~L~~dle~Ll~~~~~~a~----e~~~~lR~r~~~~L~~ar~~l~~~~~~~~~~~k~aa~~td~yV~e~ 79 (101)
T PRK10404 4 QFGDTRIDDDLTLLSETLEEVLRSSGDPAD----QKYVELKARAEKALDDVKKRVSQASDSYYYRAKQAVYRADDYVHEK 79 (101)
T ss_pred cchhhHHHHHHHHHHHHHHHHHHHhhhhhH----HHHHHHHHHHHHHHHHHHHHHHHhHHHHHHHHHHHHHHHHHHHHhC
Confidence 346788999999999999999987776642 24455555566666666644444433 3345788888888887775
Q ss_pred hhc
Q 009572 173 NEK 175 (532)
Q Consensus 173 ~~~ 175 (532)
--+
T Consensus 80 Pw~ 82 (101)
T PRK10404 80 PWQ 82 (101)
T ss_pred cHH
Confidence 444
No 41
>PF11464 Rbsn: Rabenosyn Rab binding domain; InterPro: IPR021565 Rabenosyn-5 (Rbsn) is a multivalent effector with interacts with the Rab family.Rsbn contains distinct Rab4 and Rab5 binding sites within residues 264-500 and 627-784 respectively []. Rab proteins are GTPases involved in the regulation of all stages of membrane trafficking []. ; PDB: 1Z0K_B 1YZM_A 1Z0J_B.
Probab=44.16 E-value=86 Score=23.42 Aligned_cols=38 Identities=18% Similarity=0.283 Sum_probs=32.6
Q ss_pred hhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhh
Q 009572 79 TDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLS 116 (532)
Q Consensus 79 ~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~ 116 (532)
-.|+..-++|..-||..+...=+.-|..+++|+++-+.
T Consensus 2 leQi~~I~~~I~qAk~~~r~dEV~~L~~NL~EL~~e~~ 39 (42)
T PF11464_consen 2 LEQINIIESYIKQAKAARRFDEVATLEENLRELQDEID 39 (42)
T ss_dssp HHHHHHHHHHHHHHHHTT-HHHHHHHHHHHHHHHHHHH
T ss_pred HHHHHHHHHHHHHHHHhcCcHHHHHHHHHHHHHHHHHH
Confidence 47999999999999999999999999999999987543
No 42
>PRK09039 hypothetical protein; Validated
Probab=43.68 E-value=58 Score=34.68 Aligned_cols=29 Identities=17% Similarity=0.323 Sum_probs=17.9
Q ss_pred ccccccccchhHHH--HHHHHHHHHHHHHhh
Q 009572 9 RRPVRRRISHVVWW--TLCGIAVLLFIVILS 37 (532)
Q Consensus 9 ~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~ 37 (532)
||+.|+....|+-| ++.++++++.+||.+
T Consensus 6 ~~~~~~~~~~wpg~vd~~~~ll~~~~f~l~~ 36 (343)
T PRK09039 6 RRRRRRGVDYWPGFVDALSTLLLVIMFLLTV 36 (343)
T ss_pred cCCCCCCCCCCchHHHHHHHHHHHHHHHHHH
Confidence 44456678888865 466666655555433
No 43
>PF10073 DUF2312: Uncharacterized protein conserved in bacteria (DUF2312); InterPro: IPR018753 This entry is represented by Azospirillum phage Cd, Gp10. The characteristics of the protein distribution suggest prophage matches in addition to the phage matches. Members of this family of hypothetical bacterial proteins have no known function.
Probab=41.08 E-value=1.2e+02 Score=25.49 Aligned_cols=45 Identities=16% Similarity=0.141 Sum_probs=34.0
Q ss_pred HHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHH
Q 009572 102 WELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRL 158 (532)
Q Consensus 102 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl 158 (532)
.+|++-|..+||+-. +-...-..+..+-+.||..+||.+.+-+.+
T Consensus 4 ~~Lr~~ieRiErLEe------------Ek~~i~~dikdVyaEAK~~GfD~K~lr~ii 48 (74)
T PF10073_consen 4 EQLRQFIERIERLEE------------EKKAISDDIKDVYAEAKGNGFDTKALRQII 48 (74)
T ss_pred HHHHHHHHHHHHHHH------------HHHHHHHHHHHHHHHHHhCCCCHHHHHHHH
Confidence 478888888888732 334556677888999999999999875543
No 44
>PF10112 Halogen_Hydrol: 5-bromo-4-chloroindolyl phosphate hydrolysis protein; InterPro: IPR018770 This entry consists of prokaryotic proteins that mediate the hydrolysis of 5-bromo-4-chloroindolyl phosphate bonds.
Probab=41.01 E-value=1.5e+02 Score=28.67 Aligned_cols=14 Identities=14% Similarity=0.185 Sum_probs=7.8
Q ss_pred HHhhhHHHHHHHHH
Q 009572 76 RQLTDQISLAKAFV 89 (532)
Q Consensus 76 ~~~~dq~~~a~~y~ 89 (532)
+.++.++.-|+.|+
T Consensus 71 ~~~~~~l~ea~~~i 84 (199)
T PF10112_consen 71 EYIREILEEAKEKI 84 (199)
T ss_pred HHHHHHHHHHHHHH
Confidence 44555555566555
No 45
>PLN02742 Probable galacturonosyltransferase
Probab=37.88 E-value=3.2e+02 Score=31.06 Aligned_cols=138 Identities=15% Similarity=0.039 Sum_probs=76.0
Q ss_pred Cccc--cccccchhHHHHHHHHHHHHHHHHhhhcccccCCCCCCCCccchhhhccCCCccccccChhhHHHHhhhHHHHH
Q 009572 8 FRRP--VRRRISHVVWWTLCGIAVLLFIVILSKESQIESRPTFPKRYDRRDRIMEGLNITDEMLSANSVTRQLTDQISLA 85 (532)
Q Consensus 8 ~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~dq~~~a 85 (532)
.||| .||+....+-=++..+++..+++.+++.-+...+.+...+..+..-..+ ...+|..-..+.+
T Consensus 2 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~----------- 69 (534)
T PLN02742 2 RRRPADFRRPVRRRLSQWIWWLLGGFSVLGLVLFVHKHSEIEPRPPLSERNYRKE-EVNHEGLNFTEEM----------- 69 (534)
T ss_pred CCchhhcccchhcchhhhHHHHHHHHHHHHHHHHHhccCCCCCCCCCcccccccc-ccccccccchhhh-----------
Confidence 3555 3445444445566667777777888888876666553322221111111 1122222111111
Q ss_pred HHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccC--hHHHHHHHHHHHH
Q 009572 86 KAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYD--SATMIMRLKAKIQ 163 (532)
Q Consensus 86 ~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~--~~~~~~kl~~~~~ 163 (532)
.+-...+|.|+.|+---.--++=|...+.+-..++....|+..+.+++.|..-.-+ -+....|+++|=+
T Consensus 70 ---------~~~~~~~~~l~dql~~Ak~y~~ia~~~~~~~l~~el~~~i~e~~~~l~~a~~d~~~~~~~~~~~~~~~m~~ 140 (534)
T PLN02742 70 ---------LSATSFSRQLADQITLAKAYVVIAKEHNNLQLAWELSAQIRNCQLLLSKAATRGEPITVEEAEPIIRDLAA 140 (534)
T ss_pred ---------cChHHHHHHHHHHHHHHHHHHHHhccCCcHHHHHHHHHHHHHHHHHHHHhhcccccCCchhHHHHHHHHHH
Confidence 12234678888888655555555555544333577788999999999988553332 2556666776655
Q ss_pred hHH
Q 009572 164 GLE 166 (532)
Q Consensus 164 ~~e 166 (532)
.+.
T Consensus 141 ~i~ 143 (534)
T PLN02742 141 LIY 143 (534)
T ss_pred HHH
Confidence 554
No 46
>COG4068 Uncharacterized protein containing a Zn-ribbon [Function unknown]
Probab=36.65 E-value=15 Score=29.22 Aligned_cols=18 Identities=17% Similarity=0.211 Sum_probs=14.4
Q ss_pred HHHHHHHHHHHHHHHHhh
Q 009572 20 VWWTLCGIAVLLFIVILS 37 (532)
Q Consensus 20 ~~~~~~~~~~~~~~~~~~ 37 (532)
.+|.+++++.+++++|..
T Consensus 45 ~~~~li~aLi~v~vvL~~ 62 (64)
T COG4068 45 ILMFLILALILVMVVLPY 62 (64)
T ss_pred HHHHHHHHHHHHHHhhcc
Confidence 388999999888887753
No 47
>PRK10788 periplasmic folding chaperone; Provisional
Probab=35.46 E-value=4.9e+02 Score=29.74 Aligned_cols=26 Identities=23% Similarity=0.309 Sum_probs=18.9
Q ss_pred ccccchhHHHHHHHHHHHHHHHHhhhc
Q 009572 13 RRRISHVVWWTLCGIAVLLFIVILSKE 39 (532)
Q Consensus 13 ~~~~~~~~~~~~~~~~~~~~~~~~~~~ 39 (532)
|...+.|++|+++|++++++++ +++.
T Consensus 6 R~~~~~~~~~~i~~li~l~F~~-~G~~ 31 (623)
T PRK10788 6 RTAANSVVLKIILALIILSFIL-TGVG 31 (623)
T ss_pred HhhccChHHHHHHHHHHHHHHH-Hcch
Confidence 5567889999999987777444 4443
No 48
>PF12273 RCR: Chitin synthesis regulation, resistance to Congo red; InterPro: IPR020999 RCR proteins are ER membrane proteins that regulate chitin deposition in fungal cell walls. Although chitin, a linear polymer of beta-1,4-linked N-acetylglucosamine, constitutes only 2% of the cell wall it plays a vital role in the overall protection of the cell wall against stress, noxious chemicals and osmotic pressure changes. Congo red is a cell wall-disrupting benzidine-type dye extensively used in many cell wall mutant studies that specifically targets chitin in yeast cells and inhibits growth. RCR proteins render the yeasts resistant to Congo red by diminishing the content of chitin in the cell wall []. RCR proteins are probably regulating chitin synthase III interact directly with ubiquitin ligase Rsp5, and the VPEY motif is necessary for this, via interaction with the WW domains of Rsp5 [].
Probab=35.13 E-value=19 Score=32.68 Aligned_cols=20 Identities=25% Similarity=0.469 Sum_probs=9.1
Q ss_pred hHHHHHHHHHHHHHHHHhhh
Q 009572 19 VVWWTLCGIAVLLFIVILSK 38 (532)
Q Consensus 19 ~~~~~~~~~~~~~~~~~~~~ 38 (532)
|++|+++-+++++.|++++.
T Consensus 2 W~l~~iii~~i~l~~~~~~~ 21 (130)
T PF12273_consen 2 WVLFAIIIVAILLFLFLFYC 21 (130)
T ss_pred eeeHHHHHHHHHHHHHHHHH
Confidence 55555544444444444433
No 49
>PF05478 Prominin: Prominin; InterPro: IPR008795 The prominins are an emerging family of proteins that, among the multispan membrane proteins, display a novel topology. Mouse and Homo sapiens prominin and (Mus musculus) prominin-like 1 (PROML1) are predicted to contain five membrane spanning domains, with an N-terminal domain exposed to the extracellular space followed by four, alternating small cytoplasmic and large extracellular, loops and a cytoplasmic C-terminal domain []. The exact function of prominin is unknown although in humans defects in PROM1, the gene coding for prominin, cause retinal degeneration [].; GO: 0016021 integral to membrane
Probab=34.86 E-value=1.2e+02 Score=36.07 Aligned_cols=49 Identities=12% Similarity=0.196 Sum_probs=31.1
Q ss_pred HHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhcccc
Q 009572 130 TETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSK 178 (532)
Q Consensus 130 ~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~ 178 (532)
+.+.+..|.+.+..+++.--.-+.....|+.....+++.++..|.+-..
T Consensus 237 ~L~~i~~l~~~~~~~~~~L~~v~~~~~~L~~~~~qL~~~L~~vK~~L~~ 285 (806)
T PF05478_consen 237 ALDSILDLAQAMQETKELLQNVNSSLKDLQEYQSQLRDGLRGVKRDLNN 285 (806)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 3445555555555555555555666667777777777777777776544
No 50
>PRK04778 septation ring formation regulator EzrA; Provisional
Probab=33.47 E-value=1.7e+02 Score=33.29 Aligned_cols=127 Identities=16% Similarity=0.187 Sum_probs=0.0
Q ss_pred hHHHHHHHHHHHHHHHHhhhcccccC-------------CCCCCCCccchhhhc--cCCCccccccChhhHHHHhhhHHH
Q 009572 19 VVWWTLCGIAVLLFIVILSKESQIES-------------RPTFPKRYDRRDRIM--EGLNITDEMLSANSVTRQLTDQIS 83 (532)
Q Consensus 19 ~~~~~~~~~~~~~~~~~~~~~~~~~~-------------~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~~dq~~ 83 (532)
+++++++.+++++.++.++++.+... ..|+ .+.+. +++|+|++....=.-.++=-|.+.
T Consensus 4 ~~ii~i~ii~i~~~~~~~~~rr~~~~~i~~Le~~k~~l~~~pv------~~el~kvk~l~l~Ges~~~f~~w~~~~~~i~ 77 (569)
T PRK04778 4 YLIIAIVVIIIIAYLAGLILRKRNYKRIDELEERKQELENLPV------NDELEKVKKLNLTGQSEEKFEEWRQKWDEIV 77 (569)
T ss_pred hHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhcCCH------HHHHHHHhcCCCCcccHHHHHHHHHHHHHHH
Q ss_pred HHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHH
Q 009572 84 LAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQ 163 (532)
Q Consensus 84 ~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~ 163 (532)
..++-+++..|-++....+-.-+..|...+...+..|..+.. .++.+..
T Consensus 78 ---------------------~~~~~~ie~~l~~ae~~~~~~~f~~a~~~~~~~~~~l~~~e~----------~~~~i~~ 126 (569)
T PRK04778 78 ---------------------TNSLPDIEEQLFEAEELNDKFRFRKAKHEINEIESLLDLIEE----------DIEQILE 126 (569)
T ss_pred ---------------------HhhhhhHHHHHHHHHHHHhcccHHHHHHHHHHHHHHHHHHHH----------HHHHHHH
Q ss_pred hHHHHhhhhhhcccccccc
Q 009572 164 GLEEQMGSVNEKSSKYGQI 182 (532)
Q Consensus 164 ~~e~~~~~~~~~~~~~~~~ 182 (532)
.+++.+..+.++..-+.++
T Consensus 127 ~l~~l~~~e~~nr~~v~~l 145 (569)
T PRK04778 127 ELQELLESEEKNREEVEQL 145 (569)
T ss_pred HHHHHHHHHHHHHHHHHHH
No 51
>PF03314 DUF273: Protein of unknown function, DUF273; InterPro: IPR004988 This is a family of proteins of unknown function.
Probab=32.62 E-value=30 Score=34.52 Aligned_cols=24 Identities=29% Similarity=0.560 Sum_probs=20.5
Q ss_pred hhhhhcCCCCeEEEEecceeeccC
Q 009572 344 YIPEVFPALKKVVFLDDDVVVQKD 367 (532)
Q Consensus 344 ~lPellP~ldKVLYLD~DvIV~~D 367 (532)
.+..+||+++-||+||+||-|...
T Consensus 34 vva~~L~~~~~vlflDaDigVvNp 57 (222)
T PF03314_consen 34 VVAKILPEYDWVLFLDADIGVVNP 57 (222)
T ss_pred HHHHHhccCCEEEEEcCCceeecC
Confidence 367889999999999999998644
No 52
>PF11932 DUF3450: Protein of unknown function (DUF3450); InterPro: IPR016866 There is currently no experimental data for members of this group or their homologues, nor do they exhibit features indicative of any function. However, they are found in an operon along with components of a TonB transport system (typified by Vibrio cholerae TonB2 [], and are predicted to be localized to the periplasmic space. Caution: the low-complexity nature of these sequences produces spurious BLAST hits to chromosome segregation ATPases (which are much longer in length and contain canonical Walker motifs). Accordingly, some members are misidentified as such.
Probab=32.50 E-value=93 Score=31.33 Aligned_cols=137 Identities=12% Similarity=0.106 Sum_probs=90.4
Q ss_pred CccccccChhhHHHHhhhHHHHHHHHHH-HHhcC-CchHHHHHHHHHHHHHHHHhhhhhc-------------CCCCCCc
Q 009572 63 NITDEMLSANSVTRQLTDQISLAKAFVV-IAKES-NNLQFAWELSAQIRNSQVLLSNAAT-------------RRTPLTT 127 (532)
Q Consensus 63 ~~~~~~~~~~~~~~~~~dq~~~a~~y~~-~a~~~-~~~~~~~~~~~~~~~~~~~~~~~~~-------------~~~~~~~ 127 (532)
+..+|....-.-.++++.|+-..++|-. +.+.- ++.+-..+|.++|.+++..-.+-.. ..|+ |
T Consensus 46 ~~~~e~~~L~~e~~~l~~e~e~L~~~~~~l~~~v~~q~~el~~L~~qi~~~~~~~~~l~p~m~~m~~~L~~~v~~d~--P 123 (251)
T PF11932_consen 46 QWDDEKQELLAEYRQLEREIENLEVYNEQLERQVASQEQELASLEQQIEQIEETRQELVPLMEQMIDELEQFVELDL--P 123 (251)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHhcCC--C
Confidence 5666776777788899999999999873 22222 3444455667777766644333111 2233 2
Q ss_pred hhHH---HHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhccccccccccccCCccccchhhhhhHHHhh
Q 009572 128 RETE---TAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEKSSKYGQIAAEEVPKSLYCLGVRLTTEWFG 204 (532)
Q Consensus 128 ~~~~---~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~~~~~~~~a~~~~Pk~~hcl~~rl~~e~~~ 204 (532)
.... +++..+..++..+ .. ....|+|..+.....++..-..-+.+=+.+..++-|...-+|-+=...=||.
T Consensus 124 f~~~eR~~Rl~~L~~~l~~~---dv---~~~ek~r~vlea~~~E~~yg~~i~~~~~~i~~dG~~~~V~~LrlGr~~l~~~ 197 (251)
T PF11932_consen 124 FLLEERQERLARLRAMLDDA---DV---SLAEKFRRVLEAYQIEMEYGRTIEVYQGTITLDGEERQVDFLRLGRVALYYQ 197 (251)
T ss_pred CChHHHHHHHHHHHHhhhcc---CC---CHHHHHHHHHHHHHHHHHhCCceeEEEEEEeECCeEEEEEEEeecchhheeE
Confidence 2333 3455555555444 22 3456899999999999999999999999998899888877766666666665
Q ss_pred Cch
Q 009572 205 NQN 207 (532)
Q Consensus 205 ~~~ 207 (532)
++.
T Consensus 198 t~D 200 (251)
T PF11932_consen 198 TLD 200 (251)
T ss_pred CCC
Confidence 554
No 53
>PRK13694 hypothetical protein; Provisional
Probab=32.28 E-value=1.9e+02 Score=24.75 Aligned_cols=45 Identities=20% Similarity=0.138 Sum_probs=33.2
Q ss_pred HHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHH
Q 009572 101 AWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMR 157 (532)
Q Consensus 101 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~k 157 (532)
+.+|++=|.-+||+=. +-...-..+..+.+.||..+||.+.|=+.
T Consensus 11 ~~~Lr~fIERIERLEe------------Ekk~i~~dikdVyaEAK~~GfD~K~~r~i 55 (83)
T PRK13694 11 KEQLRAFIERIERLEE------------EKKTISDDIKDVYAEAKGNGFDVKALKTI 55 (83)
T ss_pred HHHHHHHHHHHHHHHH------------HHHHHHHHHHHHHHHHHhcCCcHHHHHHH
Confidence 3578888888888722 33445566778899999999999987544
No 54
>PF13624 SurA_N_3: SurA N-terminal domain; PDB: 3NRK_A.
Probab=31.87 E-value=1.7e+02 Score=26.57 Aligned_cols=73 Identities=18% Similarity=0.216 Sum_probs=26.6
Q ss_pred HHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHHHHhhhhhhc
Q 009572 99 QFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLEEQMGSVNEK 175 (532)
Q Consensus 99 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e~~~~~~~~~ 175 (532)
.+.++.-.++-+-+-+..+|...+-..+..++...++.+..... .-.+|-+.+..-|++. ..+|++.+..-+.
T Consensus 74 ~~~~~~l~~lI~~~ll~q~A~~~gi~vsd~ev~~~i~~~~~f~~---~g~~~~~~f~~~L~~~-g~t~~~~~~~lr~ 146 (154)
T PF13624_consen 74 QLKQQVLDQLIDQKLLLQEAKKLGISVSDAEVDDAIKQIPAFQE---NGKFDKEAFEEFLKQQ-GMTEEEFKEELRE 146 (154)
T ss_dssp -HHHHHHHHHHHHHHHHHHHHHTT----HHHHHHHHHH--HHHH---H----HHHHHHHHH----------------
T ss_pred HHHHHHHHHHHHHHHHHHHHHHcCCCCCHHHHHHHHHHHHHHHH---CCCCCHHHHHHHHHHh-hccccccchhhhc
Confidence 35555555555555555556555544455666666666443322 1235666666666654 5556655555444
No 55
>PF10828 DUF2570: Protein of unknown function (DUF2570); InterPro: IPR022538 This entry is represented by Bacteriophage IME08, pseT.3. The characteristics of the protein distribution suggest prophage matches in addition to the phage matches. This is a family of proteins with unknown function.
Probab=31.50 E-value=2.2e+02 Score=25.20 Aligned_cols=68 Identities=10% Similarity=0.152 Sum_probs=36.7
Q ss_pred ccChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHH
Q 009572 68 MLSANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDM 137 (532)
Q Consensus 68 ~~~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 137 (532)
+.+.+.+.+.|++++..-+.-+.-- ...+.++-.+.-...+++..++.+...-... .|..|-+.++.+
T Consensus 41 I~qq~~~~~~L~~~~~~~r~~~~~~-~~~~qq~r~~~e~~~e~ik~~lk~d~Ca~~~-~P~~V~d~L~~~ 108 (110)
T PF10828_consen 41 IQQQEDANQELKAQLQQNRQAVEEQ-QKREQQLRQQSEERRESIKTALKDDPCANTA-VPDAVIDSLRRL 108 (110)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHH-HHHHHHHHHHHHHHHHHHHHHHccCccccCC-CCHHHHHHHHHh
Confidence 3355666778888877665544322 2222344455555556666665544433333 366776666554
No 56
>PF12273 RCR: Chitin synthesis regulation, resistance to Congo red; InterPro: IPR020999 RCR proteins are ER membrane proteins that regulate chitin deposition in fungal cell walls. Although chitin, a linear polymer of beta-1,4-linked N-acetylglucosamine, constitutes only 2% of the cell wall it plays a vital role in the overall protection of the cell wall against stress, noxious chemicals and osmotic pressure changes. Congo red is a cell wall-disrupting benzidine-type dye extensively used in many cell wall mutant studies that specifically targets chitin in yeast cells and inhibits growth. RCR proteins render the yeasts resistant to Congo red by diminishing the content of chitin in the cell wall []. RCR proteins are probably regulating chitin synthase III interact directly with ubiquitin ligase Rsp5, and the VPEY motif is necessary for this, via interaction with the WW domains of Rsp5 [].
Probab=29.22 E-value=34 Score=31.00 Aligned_cols=21 Identities=19% Similarity=0.320 Sum_probs=12.3
Q ss_pred HHHHHHHHHHHHHHhhhcccc
Q 009572 22 WTLCGIAVLLFIVILSKESQI 42 (532)
Q Consensus 22 ~~~~~~~~~~~~~~~~~~~~~ 42 (532)
|+|+++|++++|++|++..-+
T Consensus 2 W~l~~iii~~i~l~~~~~~~~ 22 (130)
T PF12273_consen 2 WVLFAIIIVAILLFLFLFYCH 22 (130)
T ss_pred eeeHHHHHHHHHHHHHHHHHH
Confidence 556666666666655555554
No 57
>TIGR02977 phageshock_pspA phage shock protein A. Members of this family are the phage shock protein PspA, from the phage shock operon. This is a narrower family than the set of PspA and its homologs, sometimes several in a genome, as described by PFAM model pfam04012. PspA appears to maintain the protonmotive force under stress conditions that include overexpression of certain phage secretins, heat shock, ethanol, and protein export defects.
Probab=29.11 E-value=3.3e+02 Score=26.94 Aligned_cols=106 Identities=12% Similarity=0.093 Sum_probs=53.1
Q ss_pred ChhhHHHHhhhHHHHHHHHH--HHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhcc
Q 009572 70 SANSVTRQLTDQISLAKAFV--VIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQF 147 (532)
Q Consensus 70 ~~~~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 147 (532)
..+.+++.|+|+|.-||.=+ .+|..+.-.+-..++..++.+.+.=-..|-..++--.-+.+.......+..+...+..
T Consensus 28 ~l~q~irem~~~l~~ar~~lA~~~a~~k~~e~~~~~~~~~~~~~~~~A~~Al~~G~EdLAr~Al~~k~~~~~~~~~l~~~ 107 (219)
T TIGR02977 28 MIRLIIQEMEDTLVEVRTTSARTIADKKELERRVSRLEAQVADWQEKAELALSKGREDLARAALIEKQKAQELAEALERE 107 (219)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHCCCHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 35677788888877766633 4444433333344444445444433222222221111334444444444444444444
Q ss_pred ccChHHHHHHHHHHHHhHHHHhhhhhhc
Q 009572 148 HYDSATMIMRLKAKIQGLEEQMGSVNEK 175 (532)
Q Consensus 148 ~~~~~~~~~kl~~~~~~~e~~~~~~~~~ 175 (532)
.-.-...+.+|+..+..++.++...+.+
T Consensus 108 ~~~~~~~v~~l~~~l~~L~~ki~~~k~k 135 (219)
T TIGR02977 108 LAAVEETLAKLQEDIAKLQAKLAEARAR 135 (219)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 4444556667777777777666655444
No 58
>PF15290 Syntaphilin: Golgi-localised syntaxin-1-binding clamp
Probab=28.96 E-value=1e+02 Score=32.07 Aligned_cols=92 Identities=12% Similarity=0.115 Sum_probs=53.1
Q ss_pred ChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHH-hhhhhc--CCCCCCchhHHHHHHHHHHHHHHhhc
Q 009572 70 SANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVL-LSNAAT--RRTPLTTRETETAIRDMALLLYQAQQ 146 (532)
Q Consensus 70 ~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~-~~~~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~ 146 (532)
.+.-.+|+||-.|-= +.-+.+..+.=..|||.|+-.++.- +-+-.. .+.+ ..++|.+-|+.+.++|.-+|+
T Consensus 65 QKEV~iRHLkakLke-----s~~~l~dRetEI~eLksQL~RMrEDWIEEECHRVEAQL-ALKEARkEIkQLkQvieTmrs 138 (305)
T PF15290_consen 65 QKEVCIRHLKAKLKE-----SENRLHDRETEIDELKSQLARMREDWIEEECHRVEAQL-ALKEARKEIKQLKQVIETMRS 138 (305)
T ss_pred HHHHHHHHHHHHHHH-----HHHHHHhhHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH-HHHHHHHHHHHHHHHHHHHHh
Confidence 445567777744421 2333334444445666655333221 111111 1222 357888889999998888775
Q ss_pred cc-----------cChHHHHHHHHHHHHhHHH
Q 009572 147 FH-----------YDSATMIMRLKAKIQGLEE 167 (532)
Q Consensus 147 ~~-----------~~~~~~~~kl~~~~~~~e~ 167 (532)
.. .|...=-+||...|++||=
T Consensus 139 sL~ekDkGiQKYFvDINiQN~KLEsLLqsMEl 170 (305)
T PF15290_consen 139 SLAEKDKGIQKYFVDINIQNKKLESLLQSMEL 170 (305)
T ss_pred hhchhhhhHHHHHhhhhhhHhHHHHHHHHHHH
Confidence 43 4556666779999999984
No 59
>PHA00407 phage lambda Rz1-like protein
Probab=28.30 E-value=45 Score=27.99 Aligned_cols=63 Identities=21% Similarity=0.266 Sum_probs=37.4
Q ss_pred ccCccccccccchhHHHHHHHHHHHHHHHHhhhcccccCCCC-CCCCccchhhhccCCCccccccCh
Q 009572 6 QDFRRPVRRRISHVVWWTLCGIAVLLFIVILSKESQIESRPT-FPKRYDRRDRIMEGLNITDEMLSA 71 (532)
Q Consensus 6 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~~~~~~~~~~~~~~~~~~~~~ 71 (532)
..++-..+.+++.| -=+|+|++.+....+-+-.+.. ..| -+.+..-....|-..|.|.|+++.
T Consensus 18 ~~y~~stkktl~rw-kaaLIGlllicv~tISGCaSes--~lp~ep~k~TVDaSLMVepNlT~~ml~V 81 (84)
T PHA00407 18 MKYRLSTKKTLRRW-KAALIGLLLICVATISGCASES--NLPVEPQKVTVDASLMVEPNLTKEMLSV 81 (84)
T ss_pred hcCcchhhhhhHHH-HHHHHHHHHHHHHHHhhhhhcc--cCCCCcccceeeeeeeeCcchhHHHHHH
Confidence 34455566677777 5688898888777776666552 222 222333333344446888887653
No 60
>PF05546 She9_MDM33: She9 / Mdm33 family; InterPro: IPR008839 Members of this family are mitochondrial inner membrane proteins with a role in inner mitochondrial membrane organisation and biogenesis []. The yeast Mdm33 protein assembles into an oligomeric complex in the inner membrane where it performs homotypic protein-protein interactions. It has been suggested that Mdm33 plays a distinct role, possibly involved in fission of the mitochondrial inner membrane [].
Probab=28.29 E-value=48 Score=32.94 Aligned_cols=27 Identities=41% Similarity=0.500 Sum_probs=22.3
Q ss_pred ccccchhHHHHHHHHHHHHHHHHhhhc
Q 009572 13 RRRISHVVWWTLCGIAVLLFIVILSKE 39 (532)
Q Consensus 13 ~~~~~~~~~~~~~~~~~~~~~~~~~~~ 39 (532)
=||.|.|.-|.|.|+=+++++++-++.
T Consensus 147 IRr~STwgT~~lmgvNvllFl~~~~~~ 173 (207)
T PF05546_consen 147 IRRASTWGTWGLMGVNVLLFLVAQLLV 173 (207)
T ss_pred HHhHHHHHHHHHHHHHHHHHHHHHHHh
Confidence 378999999999998888888776554
No 61
>PRK12302 bssR biofilm formation regulatory protein BssR; Reviewed
Probab=27.12 E-value=40 Score=30.02 Aligned_cols=25 Identities=32% Similarity=0.300 Sum_probs=14.7
Q ss_pred HHHHHHHHHHHHhh----ccccChHHHHH
Q 009572 132 TAIRDMALLLYQAQ----QFHYDSATMIM 156 (532)
Q Consensus 132 ~~~~~~~~~~~~~~----~~~~~~~~~~~ 156 (532)
..+...+..++.|- +-+.||.+++.
T Consensus 70 ~aL~~A~~aLa~AaVCLMsGhHDCPtfia 98 (127)
T PRK12302 70 SALRHAEEALATAAVCLMSGHHDCPTFIA 98 (127)
T ss_pred HHHHHHHHHHHHHHHHHHcCCCCCCceee
Confidence 34444555554443 44889998854
No 62
>PF05957 DUF883: Bacterial protein of unknown function (DUF883); InterPro: IPR010279 This family consists of several bacterial proteins of unknown function that include the Escherichia coli genes for ElaB, YgaM and YqjD.
Probab=25.25 E-value=2.8e+02 Score=23.46 Aligned_cols=74 Identities=16% Similarity=0.052 Sum_probs=44.9
Q ss_pred HHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChH-HHHHHHHHHHHhHHHHhhhhhhcc
Q 009572 99 QFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSA-TMIMRLKAKIQGLEEQMGSVNEKS 176 (532)
Q Consensus 99 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~-~~~~kl~~~~~~~e~~~~~~~~~~ 176 (532)
.+..||.+-+.+++.+++.+...+. ..+.+.-..+...+..+++..-|-. .+..+.+.....+++.++.+--++
T Consensus 2 ~l~~~l~~l~~d~~~l~~~~~~~~~----~~~~~~r~~~~~~~~~a~~~~~~~~~~~~~~~~~~~~~~~~~V~e~P~~s 76 (94)
T PF05957_consen 2 DLKAELEQLRADLEDLARSAADLAG----EKADEARDRAEEALDDARDRAEDAADQAREQAREAAEQTEDYVRENPWQS 76 (94)
T ss_pred hHHHHHHHHHHHHHHHHHHHHHhHH----HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHChHHH
Confidence 4677888888888888777665432 2334444444445544444333322 355567888888888877766554
No 63
>PF11286 DUF3087: Protein of unknown function (DUF3087); InterPro: IPR021438 This family of proteins with unknown function appears to be restricted to Gammaproteobacteria.
Probab=25.24 E-value=4.5e+02 Score=25.33 Aligned_cols=37 Identities=19% Similarity=0.357 Sum_probs=29.3
Q ss_pred ChhhHHHHhhhHHHHHHHHHHHHhcCCchHHHHHHHHHHHHHHHHhhh
Q 009572 70 SANSVTRQLTDQISLAKAFVVIAKESNNLQFAWELSAQIRNSQVLLSN 117 (532)
Q Consensus 70 ~~~~~~~~~~dq~~~a~~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~ 117 (532)
..-++++++|+|=+|+-+||. |+||+..-.+.|.+..
T Consensus 62 ~~~~~l~~~k~~p~m~Ev~Yv-----------W~LKq~ln~I~rkl~~ 98 (165)
T PF11286_consen 62 LTSALLRQLKTHPFMTEVYYV-----------WQLKQLLNKIYRKLHK 98 (165)
T ss_pred HHHHHHHHHccChHHHHHHHH-----------HHHHHHHHHHHHHHHH
Confidence 346788999999999999986 7888777777666654
No 64
>PF04012 PspA_IM30: PspA/IM30 family; InterPro: IPR007157 This family includes PspA a protein that suppresses sigma54-dependent transcription. The PspA protein, a negative regulator of the Escherichia coli phage shock psp operon, is produced when virulence factors are exported through secretins in many Gram-negative pathogenic bacteria and its homologue in plants, VIPP1, plays a critical role in thylakoid biogenesis, essential for photosynthesis. Activation of transcription by the enhancer-dependent bacterial sigma54-containing RNA polymerase occurs through ATP hydrolysis-driven protein conformational changes enabled by activator proteins that belong to the large AAA(+) mechanochemical protein family. It has been shown that PspA directly and specifically acts upon and binds to the AAA(+) domain of the PspF transcription activator [].
Probab=24.84 E-value=4.3e+02 Score=25.76 Aligned_cols=106 Identities=15% Similarity=0.125 Sum_probs=51.0
Q ss_pred ChhhHHHHhhhHHHHHHHHH--HHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhcc
Q 009572 70 SANSVTRQLTDQISLAKAFV--VIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQF 147 (532)
Q Consensus 70 ~~~~~~~~~~dq~~~a~~y~--~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 147 (532)
-.+..++.|.+++.-|+.=+ .+|....-.+-..++...+.+.+.-...|-..++--.-+.+.......+..+...+..
T Consensus 27 ~l~q~ird~e~~l~~a~~~~a~~~a~~~~le~~~~~~~~~~~~~~~~A~~Al~~g~edLAr~al~~k~~~e~~~~~l~~~ 106 (221)
T PF04012_consen 27 MLEQAIRDMEEQLRKARQALARVMANQKRLERKLDEAEEEAEKWEKQAELALAAGREDLAREALQRKADLEEQAERLEQQ 106 (221)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHcCCHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 34566777777777666533 3333322222223333333333332222222221111344555555555555555555
Q ss_pred ccChHHHHHHHHHHHHhHHHHhhhhhhc
Q 009572 148 HYDSATMIMRLKAKIQGLEEQMGSVNEK 175 (532)
Q Consensus 148 ~~~~~~~~~kl~~~~~~~e~~~~~~~~~ 175 (532)
.-....-+.+|+..+..++.++...+.+
T Consensus 107 ~~~~~~~~~~l~~~l~~l~~kl~e~k~k 134 (221)
T PF04012_consen 107 LDQAEAQVEKLKEQLEELEAKLEELKSK 134 (221)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 5555566666666666666666554443
No 65
>cd06423 CESA_like CESA_like is the cellulose synthase superfamily. The cellulose synthase (CESA) superfamily includes a wide variety of glycosyltransferase family 2 enzymes that share the common characteristic of catalyzing the elongation of polysaccharide chains. The members include cellulose synthase catalytic subunit, chitin synthase, glucan biosynthesis protein and other families of CESA-like proteins. Cellulose synthase catalyzes the polymerization reaction of cellulose, an aggregate of unbranched polymers of beta-1,4-linked glucose residues in plants, most algae, some bacteria and fungi, and even some animals. In bacteria, algae and lower eukaryotes, there is a second unrelated type of cellulose synthase (Type II), which produces acylated cellulose, a derivative of cellulose. Chitin synthase catalyzes the incorporation of GlcNAc from substrate UDP-GlcNAc into chitin, which is a linear homopolymer of beta-(1,4)-linked GlcNAc residues and Glucan Biosynthesis protein catalyzes the
Probab=24.40 E-value=3.8e+02 Score=22.97 Aligned_cols=33 Identities=9% Similarity=-0.012 Sum_probs=23.2
Q ss_pred CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHH
Q 009572 236 ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAM 270 (532)
Q Consensus 236 vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~ 270 (532)
...+.-++.|++..+.. ...+.|+.|+-+....
T Consensus 9 ~~~l~~~l~sl~~q~~~--~~~iivvdd~s~d~t~ 41 (180)
T cd06423 9 EAVIERTIESLLALDYP--KLEVIVVDDGSTDDTL 41 (180)
T ss_pred HHHHHHHHHHHHhCCCC--ceEEEEEeCCCccchH
Confidence 44566778898886653 5889999887665443
No 66
>cd04186 GT_2_like_c Subfamily of Glycosyltransferase Family GT2 of unknown function. GT-2 includes diverse families of glycosyltransferases with a common GT-A type structural fold, which has two tightly associated beta/alpha/beta domains that tend to form a continuous central sheet of at least eight beta-strands. These are enzymes that catalyze the transfer of sugar moieties from activated donor molecules to specific acceptor molecules, forming glycosidic bonds. Glycosyltransferases have been classified into more than 90 distinct sequence based families.
Probab=23.24 E-value=5e+02 Score=22.53 Aligned_cols=34 Identities=6% Similarity=0.026 Sum_probs=23.1
Q ss_pred CccchhhHHHHhhhCCCCCcEEEEEEeCcccHHHHH
Q 009572 236 ILATSVVVNSTASNSKNPDMIVFHLVTDEINYAAMK 271 (532)
Q Consensus 236 vl~~sV~I~Sil~N~~~p~~i~FHIvtd~is~~~~~ 271 (532)
...+.-++.|+...... ...+.|+.|+...+...
T Consensus 9 ~~~l~~~l~sl~~~~~~--~~~iiivdd~s~~~~~~ 42 (166)
T cd04186 9 LEYLKACLDSLLAQTYP--DFEVIVVDNASTDGSVE 42 (166)
T ss_pred HHHHHHHHHHHHhccCC--CeEEEEEECCCCchHHH
Confidence 44556788898876553 57888888877655433
No 67
>COG2332 CcmE Cytochrome c-type biogenesis protein CcmE [Posttranslational modification, protein turnover, chaperones]
Probab=23.07 E-value=71 Score=30.23 Aligned_cols=20 Identities=30% Similarity=0.463 Sum_probs=13.8
Q ss_pred HHHHHHHHHHHHHhhhcccc
Q 009572 23 TLCGIAVLLFIVILSKESQI 42 (532)
Q Consensus 23 ~~~~~~~~~~~~~~~~~~~~ 42 (532)
.++|+.+.++|+|+.+..|.
T Consensus 15 ~~a~l~~a~~l~Lyal~~ni 34 (153)
T COG2332 15 GLAGLALAVGLVLYALRSNI 34 (153)
T ss_pred HHHHHHHHHHHHHhhhccCc
Confidence 34455666778888888776
No 68
>PRK15384 type III secretion system protein; Provisional
Probab=22.79 E-value=39 Score=34.49 Aligned_cols=22 Identities=18% Similarity=0.579 Sum_probs=19.3
Q ss_pred CeEEEEecceeeccCchHHhcc
Q 009572 353 KKVVFLDDDVVVQKDLSALFSI 374 (532)
Q Consensus 353 dKVLYLD~DvIV~~DLseLw~i 374 (532)
+-+||||+|+|+.+.|.-|+--
T Consensus 217 ~GCIYLDaDMilT~KLG~ly~P 238 (336)
T PRK15384 217 SGCIYLDADMIITEKLGGIYIP 238 (336)
T ss_pred CceEEeeccceeecccccEEcC
Confidence 5689999999999999998844
No 69
>PF10799 YliH: Biofilm formation protein (YliH/bssR); InterPro: IPR020359 This entry represents Biofilm regulator, BssR (from the gene also known as yliH). It represses Escherichia coli biofilm formation in M9C glu and LB glu media but not in M9C and LB media. It may act as a global regulator of several genes involved in catabolite repression and stress response and regulation of the uptake and export of signalling pathways. It could also be involved the regulation of indole as well as uptake and export of AI-2 through a cAMP-dependent pathway [].
Probab=22.77 E-value=1.7e+02 Score=26.50 Aligned_cols=90 Identities=20% Similarity=0.268 Sum_probs=46.9
Q ss_pred ChhhHHHHhhhHHHHHH----HHHHHHhcCC------chH-------HHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHH
Q 009572 70 SANSVTRQLTDQISLAK----AFVVIAKESN------NLQ-------FAWELSAQIRNSQVLLSNAATRRTPLTTRETET 132 (532)
Q Consensus 70 ~~~~~~~~~~dq~~~a~----~y~~~a~~~~------~~~-------~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 132 (532)
+.|-+.+-|-++||-|| ||+.+-|.+| +.+ |.+|++++---++..+.+...++ .+-+.+
T Consensus 2 ~Vdrl~~~LlnkLInAridLaAYLQLRkAKGYMSVSEsdhLRdn~FeLc~e~r~~~~~l~~~l~~eE~~a----L~~a~~ 77 (127)
T PF10799_consen 2 SVDRLKRDLLNKLINARIDLAAYLQLRKAKGYMSVSESDHLRDNLFELCREMRDKAPRLKLHLDPEEWEA----LRRAGE 77 (127)
T ss_pred cHHHHHHHHHHHHHHhhhhHHHHHHHHHHcCccccchhhhHHHHHHHHHHHHHHhhHhhhhhcCHHHHHH----HHHHHH
Confidence 45667777788888876 5887666653 222 34455554444444333332222 122333
Q ss_pred HHHHHHHHHHHhhccccChHHHH----HHHHHHHHhHH
Q 009572 133 AIRDMALLLYQAQQFHYDSATMI----MRLKAKIQGLE 166 (532)
Q Consensus 133 ~~~~~~~~~~~~~~~~~~~~~~~----~kl~~~~~~~e 166 (532)
.+....+-+- +-+.||.+++ .||..-|..+.
T Consensus 78 a~a~AaVCLM---sGhHDCP~~IaVnaekLe~cL~~lt 112 (127)
T PF10799_consen 78 ALASAAVCLM---SGHHDCPTYIAVNAEKLERCLTTLT 112 (127)
T ss_pred HHHHHHHHHH---cCCCCCCceeeecHHHHHHHHHHHH
Confidence 3333332222 3488998874 45655554443
No 70
>PHA02692 hypothetical protein; Provisional
Probab=22.68 E-value=1e+02 Score=25.51 Aligned_cols=28 Identities=18% Similarity=0.001 Sum_probs=17.9
Q ss_pred cccccchhHHHHHHHHHHHHHHHHhhhc
Q 009572 12 VRRRISHVVWWTLCGIAVLLFIVILSKE 39 (532)
Q Consensus 12 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 39 (532)
.++..+.|.+|.+++++.++.+++|.+.
T Consensus 38 ~~~~~~~~~~~ii~~~~~~~~~vll~fl 65 (70)
T PHA02692 38 DRSKGVPWTTVFLIGLIAAAIGVLLCFH 65 (70)
T ss_pred cccCCcchHHHHHHHHHHHHHHHHHHHH
Confidence 3444556656677768877777776553
No 71
>COG3750 Uncharacterized protein conserved in bacteria [Function unknown]
Probab=22.67 E-value=3.7e+02 Score=22.89 Aligned_cols=46 Identities=20% Similarity=0.218 Sum_probs=33.3
Q ss_pred HHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHH
Q 009572 102 WELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLK 159 (532)
Q Consensus 102 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~ 159 (532)
-+|++-|..+||+ ..+-.........+-..||..+||.+++-..+|
T Consensus 14 ~QLrafIerIERl------------EeEk~~i~~dikdvy~eakg~GFDvKa~r~iir 59 (85)
T COG3750 14 GQLRAFIERIERL------------EEEKKTIADDIKDVYAEAKGHGFDVKAVRTIIR 59 (85)
T ss_pred HHHHHHHHHHHHH------------HHHHHHHHHHHHHHHHHHHcCCccHHHHHHHHH
Confidence 4778888888887 223344555666788899999999998866554
No 72
>PRK15383 type III secretion system protein; Provisional
Probab=22.48 E-value=41 Score=34.30 Aligned_cols=22 Identities=23% Similarity=0.527 Sum_probs=19.4
Q ss_pred CeEEEEecceeeccCchHHhcc
Q 009572 353 KKVVFLDDDVVVQKDLSALFSI 374 (532)
Q Consensus 353 dKVLYLD~DvIV~~DLseLw~i 374 (532)
+-+||||+|+|+.+.|.-|+--
T Consensus 220 ~GCIYLD~DMilT~KLG~ly~P 241 (335)
T PRK15383 220 GGCIYLDADMLLTDKLGTLYLP 241 (335)
T ss_pred CceEEeecceeeecccccEEcC
Confidence 5699999999999999998844
No 73
>PRK15382 non-LEE encoded effector protein NleB; Provisional
Probab=22.27 E-value=42 Score=34.25 Aligned_cols=22 Identities=23% Similarity=0.641 Sum_probs=19.4
Q ss_pred CeEEEEecceeeccCchHHhcc
Q 009572 353 KKVVFLDDDVVVQKDLSALFSI 374 (532)
Q Consensus 353 dKVLYLD~DvIV~~DLseLw~i 374 (532)
+-+||||+|+|+.+.|.-|+--
T Consensus 212 ~GCIYLD~DMilT~KLG~ly~P 233 (326)
T PRK15382 212 EGCIYLDADMIITDKLGVLYAP 233 (326)
T ss_pred CceEEeecceeeecccccEEcC
Confidence 5699999999999999998844
No 74
>PF00220 Hormone_4: Neurohypophysial hormones, N-terminal Domain; InterPro: IPR022423 Oxytocin (or ocytocin) and vasopressin [] are small (nine amino acid residues), structurally and functionally related neurohypophysial peptide hormones. Oxytocin causes contraction of the smooth muscle of the uterus and of the mammary gland while vasopressin has a direct antidiuretic action on the kidney and also causes vasoconstriction of the peripheral vessels. Like the majority of active peptides, both hormones are synthesized as larger protein precursors that are enzymatically converted to their mature forms. Peptides belonging to this family are also found in birds, fish, reptiles and amphibians (mesotocin, isotocin, valitocin, glumitocin, aspargtocin, vasotocin, seritocin, asvatocin, phasvatocin), in worms (annetocin), octopi (cephalotocin), locust (locupressin or neuropeptide F1/F2) and in molluscs (conopressins G and S) []. The pattern developed to detect this category of peptides spans their entire sequence and includes four invariant amino acid residues. .; GO: 0005185 neurohypophyseal hormone activity, 0005576 extracellular region
Probab=20.93 E-value=44 Score=17.06 Aligned_cols=8 Identities=13% Similarity=0.563 Sum_probs=6.1
Q ss_pred ccccccCC
Q 009572 525 QLQQCNFH 532 (532)
Q Consensus 525 fl~~cn~~ 532 (532)
|++.|+++
T Consensus 2 ~i~nCP~G 9 (9)
T PF00220_consen 2 YIRNCPIG 9 (9)
T ss_pred ccccCCCC
Confidence 67889874
No 75
>PF02532 PsbI: Photosystem II reaction centre I protein (PSII 4.8 kDa protein); InterPro: IPR003686 Oxygenic photosynthesis uses two multi-subunit photosystems (I and II) located in the cell membranes of cyanobacteria and in the thylakoid membranes of chloroplasts in plants and algae. Photosystem II (PSII) has a P680 reaction centre containing chlorophyll 'a' that uses light energy to carry out the oxidation (splitting) of water molecules, and to produce ATP via a proton pump. Photosystem I (PSI) has a P700 reaction centre containing chlorophyll that takes the electron and associated hydrogen donated from PSII to reduce NADP+ to NADPH. Both ATP and NADPH are subsequently used in the light-independent reactions to convert carbon dioxide to glucose using the hydrogen atom extracted from water by PSII, releasing oxygen as a by-product. PSII is a multisubunit protein-pigment complex containing polypeptides both intrinsic and extrinsic to the photosynthetic membrane [, ]. Within the core of the complex, the chlorophyll and beta-carotene pigments are mainly bound to the antenna proteins CP43 (PsbC) and CP47 (PsbB), which pass the excitation energy on to the reaction centre proteins D1 (Qb, PsbA) and D2 (Qa, PsbD) that bind all the redox-active cofactors involved in the energy conversion process. The PSII oxygen-evolving complex (OEC) oxidises water to provide protons for use by PSI, and consists of OEE1 (PsbO), OEE2 (PsbP) and OEE3 (PsbQ). The remaining subunits in PSII are of low molecular weight (less than 10 kDa), and are involved in PSII assembly, stabilisation, dimerisation, and photo-protection []. This family represents the low molecular weight transmembrane protein PsbI, which is tightly associated with the D1/D2 heterodimer in PSII. The function of PsbI is unknown, but it may be involved in the assembly, dimerisation or stabilisation of PSII dimers [].; GO: 0015979 photosynthesis, 0009523 photosystem II, 0009539 photosystem II reaction center, 0016020 membrane; PDB: 3A0H_i 3ARC_I 3A0B_i 3BZ2_I 3PRQ_I 3KZI_I 3PRR_I 2AXT_i 4FBY_I 1S5L_i ....
Probab=20.77 E-value=1.6e+02 Score=21.25 Aligned_cols=27 Identities=11% Similarity=0.095 Sum_probs=21.3
Q ss_pred HHHHHHHHHHHHHHHhhhcccccCCCC
Q 009572 21 WWTLCGIAVLLFIVILSKESQIESRPT 47 (532)
Q Consensus 21 ~~~~~~~~~~~~~~~~~~~~~~~~~~~ 47 (532)
+|+-......++|.+|++.++...++|
T Consensus 6 ~~Vy~vV~ffv~LFifGflsnDp~RnP 32 (36)
T PF02532_consen 6 IFVYTVVIFFVSLFIFGFLSNDPGRNP 32 (36)
T ss_dssp HHHHHHHHHHHHHHHHHHHTTCTTSSS
T ss_pred EeehhhHHHHHHHHhccccCCCCCCCC
Confidence 566677778888999999999766666
No 76
>PRK10807 paraquat-inducible protein B; Provisional
Probab=20.35 E-value=2.4e+02 Score=32.06 Aligned_cols=16 Identities=6% Similarity=0.260 Sum_probs=8.3
Q ss_pred hhHHHHHHHHHHHHHH
Q 009572 128 RETETAIRDMALLLYQ 143 (532)
Q Consensus 128 ~~~~~~~~~~~~~~~~ 143 (532)
.++++.++.++.++..
T Consensus 476 ~~L~~TL~~l~~~l~~ 491 (547)
T PRK10807 476 ADMQKTLRELNRSMQG 491 (547)
T ss_pred HHHHHHHHHHHHHHhh
Confidence 3445555555555544
No 77
>PF10146 zf-C4H2: Zinc finger-containing protein ; InterPro: IPR018482 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. This entry represents a family of proteins which appears to have a highly conserved zinc finger domain at the C-terminal end, described as -C-X2-CH-X3-H-X5-C-X2-C-. The structure is predicted to contain a coiled coil. Members of this family are annotated as being tumour-associated antigen HCA127 in humans, but this could not be confirmed.
Probab=20.12 E-value=4.9e+02 Score=26.32 Aligned_cols=84 Identities=13% Similarity=0.181 Sum_probs=60.4
Q ss_pred HHHHHHhcCCchHHHHHHHHHHHHHHHHhhhhhcCCCCCCchhHHHHHHHHHHHHHHhhccccChHHHHHHHHHHHHhHH
Q 009572 87 AFVVIAKESNNLQFAWELSAQIRNSQVLLSNAATRRTPLTTRETETAIRDMALLLYQAQQFHYDSATMIMRLKAKIQGLE 166 (532)
Q Consensus 87 ~y~~~a~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~kl~~~~~~~e 166 (532)
.+-.++...+.+++..|++..+.++ +.|-..-.+- .+.++.=|..|+.+|..+++..-.....+.++..-+.-+-
T Consensus 20 i~~e~~~~e~ee~~L~e~~kE~~~L---~~Er~~h~ee--LrqI~~DIn~lE~iIkqa~~er~~~~~~i~r~~eey~~Lk 94 (230)
T PF10146_consen 20 ILQEVESLENEEKCLEEYRKEMEEL---LQERMAHVEE--LRQINQDINTLENIIKQAESERNKRQEKIQRLYEEYKPLK 94 (230)
T ss_pred HHHHHHHHHHHHHHHHHHHHHHHHH---HHHHHHHHHH--HHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHHH
Confidence 3445666666667777766655444 3443332221 4678889999999999999988888888888888888888
Q ss_pred HHhhhhhhc
Q 009572 167 EQMGSVNEK 175 (532)
Q Consensus 167 ~~~~~~~~~ 175 (532)
+++...++.
T Consensus 95 ~~in~~R~e 103 (230)
T PF10146_consen 95 DEINELRKE 103 (230)
T ss_pred HHHHHHHHH
Confidence 888887666
Done!