Query 040035
Match_columns 228
No_of_seqs 127 out of 624
Neff 6.3
Searched_HMMs 46136
Date Fri Mar 29 04:26:58 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/040035.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/040035hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 PLN03012 Camelliol C synthase 100.0 2.8E-75 6.2E-80 572.2 16.9 228 1-228 176-414 (759)
2 PLN02993 lupeol synthase 100.0 1.7E-73 3.6E-78 560.5 17.1 228 1-228 176-414 (763)
3 KOG0497 Oxidosqualene-lanoster 100.0 4.8E-68 1E-72 507.5 10.8 228 1-228 176-413 (760)
4 TIGR03463 osq_cycl 2,3-oxidosq 100.0 3.6E-65 7.7E-70 497.6 16.7 220 1-228 71-302 (634)
5 cd02892 SQCY_1 Squalene cyclas 100.0 1.7E-58 3.7E-63 451.0 16.5 216 1-226 75-301 (634)
6 TIGR01787 squalene_cyclas squa 100.0 1.1E-54 2.3E-59 423.4 15.4 207 1-228 75-292 (621)
7 TIGR01507 hopene_cyclase squal 100.0 1.2E-54 2.7E-59 423.6 15.2 206 1-228 91-312 (635)
8 COG1657 SqhC Squalene cyclase 99.8 2.6E-19 5.7E-24 170.2 3.9 179 11-224 1-191 (517)
9 KOG0497 Oxidosqualene-lanoster 95.5 0.015 3.3E-07 57.8 4.1 107 4-115 199-315 (760)
10 PF13243 Prenyltrans_1: Prenyl 92.8 0.091 2E-06 39.4 2.6 32 2-36 74-105 (109)
11 COG1657 SqhC Squalene cyclase 92.6 0.08 1.7E-06 51.5 2.5 135 42-185 341-480 (517)
12 PLN03012 Camelliol C synthase 83.1 1.9 4.2E-05 44.0 5.0 52 161-214 589-650 (759)
13 cd02897 A2M_2 Proteins similar 80.9 2.2 4.8E-05 37.8 4.2 56 159-216 99-173 (292)
14 PF13243 Prenyltrans_1: Prenyl 79.1 1.6 3.4E-05 32.6 2.2 50 162-213 46-103 (109)
15 PF13249 Prenyltrans_2: Prenyl 74.9 0.85 1.8E-05 34.0 -0.3 31 3-36 74-104 (113)
16 PLN02993 lupeol synthase 71.8 6.2 0.00013 40.5 4.9 52 161-214 589-650 (763)
17 TIGR03463 osq_cycl 2,3-oxidosq 66.9 10 0.00023 37.9 5.3 52 161-214 476-536 (634)
18 TIGR01507 hopene_cyclase squal 64.8 7.9 0.00017 38.8 4.0 30 4-36 319-348 (635)
19 TIGR01787 squalene_cyclas squa 61.1 11 0.00025 37.6 4.3 47 166-214 50-106 (621)
20 cd02892 SQCY_1 Squalene cyclas 49.6 25 0.00054 35.1 4.6 48 166-215 50-107 (634)
21 PF08102 Antimicrobial_7: Scor 45.4 59 0.0013 21.0 4.2 38 140-177 4-41 (43)
22 PF00432 Prenyltrans: Prenyltr 38.5 32 0.00068 21.7 2.3 21 164-186 3-23 (44)
23 KOG1062 Vesicle coat complex A 35.2 56 0.0012 33.8 4.5 45 141-185 292-336 (866)
24 PF08157 NUC129: NUC129 domain 34.6 10 0.00023 26.5 -0.5 26 8-36 1-26 (63)
25 cd02889 SQCY Squalene cyclase 32.0 60 0.0013 29.0 3.8 33 2-37 26-59 (348)
26 PRK14388 hypothetical protein; 31.3 80 0.0017 23.4 3.7 39 27-68 32-79 (82)
27 cd03381 PAP2_glucose_6_phospha 31.3 36 0.00078 29.9 2.2 24 5-32 176-199 (235)
28 PF04000 Sas10_Utp3: Sas10/Utp 31.1 55 0.0012 23.1 2.8 24 3-28 52-75 (85)
29 PF11352 DUF3155: Protein of u 28.3 36 0.00077 25.3 1.4 20 19-38 27-46 (90)
30 COG5507 Uncharacterized conser 27.0 26 0.00056 27.1 0.5 26 189-214 35-63 (117)
31 cd02897 A2M_2 Proteins similar 25.7 91 0.002 27.5 3.9 144 3-196 142-289 (292)
32 PF13153 DUF3985: Protein of u 24.6 46 0.00099 21.4 1.2 10 6-15 19-28 (44)
33 cd02889 SQCY Squalene cyclase 22.1 1.2E+02 0.0025 27.1 3.8 31 3-36 221-251 (348)
34 PF01122 Cobalamin_bind: Eukar 20.6 1.5E+02 0.0032 27.5 4.2 53 159-213 212-269 (326)
No 1
>PLN03012 Camelliol C synthase
Probab=100.00 E-value=2.8e-75 Score=572.19 Aligned_cols=228 Identities=69% Similarity=1.353 Sum_probs=219.9
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
|||||+||+||||+|+++|++++|+|+|||+|||++|||++ +||+|||+|+|+|||||||||+|+||||+
T Consensus 176 ~~~Tv~~YvaLRllG~~~d~~~~~~m~rAR~~Il~~GGa~~~p~w~K~wLA~lG~y~W~g~np~PpElwLLP~~~P~hp~ 255 (759)
T PLN03012 176 MFCTTLNYICMRILGEGPDGGHDNACGRARDWILDHGGATYIPSWGKTWLSILGVFDWSGSNPMPPEFWILPSFFPIHPA 255 (759)
T ss_pred chhHHHHHHHHHHcCCCCCCCCcHHHHHHHHHHHHcCCcccCchHHHHHHHHcCccccCCCCCCChhHHHccCcCCccHH
Confidence 79999999999999999997645899999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhh
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPI 150 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~ 150 (228)
+||||||+||+||+|||+|||++|++|++.+||+|||++||++|||.++|+.||++|+|+||+++++++|..|+.++|++
T Consensus 256 ~~~~~~R~vy~Pmsyly~~R~~~~~~~~i~~lr~ELy~~py~~i~w~~~r~~~a~~D~y~p~~~~~~~~~~~l~~~~~~~ 335 (759)
T PLN03012 256 KMWCYCRLVYLPMSYLYGKRFVGPISPLILQLREEIYLQPYAEINWMKARHLCAKEDAYCPHPLIQDLIWDCLYIFAEPF 335 (759)
T ss_pred HHHHHHHHHHHHHHHHhcCCccccCCchhhhhHHHhCCCCccccChhhhccccccccccCCchHHHhhhHHHHHHHHHHH
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999998
Q ss_pred hccCCC-hHHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccCCCCHHHHHHHhhhccceEecCCceeeeeC
Q 040035 151 LNRWPL-NKLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIEDPNSDYFKKHLPRIGEYLWVGEDGMKVQVR 228 (228)
Q Consensus 151 ~~~~~~-~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~p~sp~~~~~~~~l~~~lw~~~dG~~~q~~ 228 (228)
+..++. ++||++|+++|++||+.|+|+|.|+|++||++++|||+||+++||||+||+|++||+||+|+++|||+||+|
T Consensus 336 l~~~~~~~~LR~~Al~~a~~~I~~ed~~t~y~~i~pv~~~l~ml~~~~~~p~~~~~k~hl~ri~d~lw~~~dGm~~q~~ 414 (759)
T PLN03012 336 LACWPFNKLLREKALGLAMKHIHYEDENSRYITIGCVEKALCMLACWVEDPNGDHFKKHLLRISDYLWIAEDGMKMQSF 414 (759)
T ss_pred hhcccccHHHHHHHHHHHHHHHHhcCCCCCEeeHHHHHHHHHHHHHhCCCCCCHHHHHHHHHhhhcEEEeCCceEEcCC
Confidence 765543 379999999999999999999999999999999999999999999999999999999999999999999998
No 2
>PLN02993 lupeol synthase
Probab=100.00 E-value=1.7e-73 Score=560.48 Aligned_cols=228 Identities=68% Similarity=1.315 Sum_probs=218.7
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
|||||+||+||||+|+++|+|++|+|+|||+|||++|||++ +||+|||+|+|+|||||||||+||||||+
T Consensus 176 ~~~Tv~~Y~aLRllG~~~d~~~~p~m~rAR~~Il~~GGa~~~~~wtK~wLAllG~y~W~g~~p~PpElwLLP~~~P~hp~ 255 (763)
T PLN02993 176 MFCTVLNYICLRMLGEGPNGGRENACKRARQWILDHGGVTYIPSWGKFWLSILGIYDWSGTNPMPPEIWLLPSFLPIHLG 255 (763)
T ss_pred chHHHHHHHHHHHcCCCCCCCCCHHHHHHHHHHHHcCCcccCchHHHHHHHHcCCcccCCCCCCChhHHHccCcCCccHH
Confidence 79999999999999999994434999999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhh
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPI 150 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~ 150 (228)
+||||+|+||+||+|||+|||++|++|++.+||+|||++||++|||.++|+.|+++|+|+||+++++.+++.+.++++++
T Consensus 256 ~~~~~~R~v~vPmsyl~~~r~~~~~~~~i~~lr~ELy~~py~~i~~~~~r~~~~~~d~y~p~~~~~~~~~~~l~~~~~~~ 335 (763)
T PLN02993 256 KTLCYTRMVYMPMSYLYGKRFVGPITPLIMLLREELHLQPYEEINWNKARRLCAKEDMYYPHPLVQDLIWDTLHNFVEPF 335 (763)
T ss_pred HhHHhhhhhHHhHHHHhcCCcccCCCchhhhhhHHhccCCchhcChHhhcCCccccCCCCCchHHHHHHHHHHHHHHhhc
Confidence 99999999999999999999999999999999999999999999999999999999999999998899999999999988
Q ss_pred hccCCCh-HHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccCCCCHHHHHHHhhhccceEecCCceeeeeC
Q 040035 151 LNRWPLN-KLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIEDPNSDYFKKHLPRIGEYLWVGEDGMKVQVR 228 (228)
Q Consensus 151 ~~~~~~~-~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~p~sp~~~~~~~~l~~~lw~~~dG~~~q~~ 228 (228)
+.+++.+ +||++|+++|+++|+++|++|+|+||++|++++|||+||+++||||+|++|++||+||+|+++|||+||+|
T Consensus 336 l~~~p~~~~lR~~Al~~a~~~i~~ed~~t~y~~i~~vn~~l~ml~~~~~~p~~~~~~~~l~ri~d~lw~~edgm~~q~~ 414 (763)
T PLN02993 336 LTRWPLNKLVREKALQVAMKHIHYEDENSHYITIGCVEKVLCMLACWIENPNGDHFKKHLARIPDYMWVAEDGMKMQSF 414 (763)
T ss_pred ccCCcchHHHHHHHHHHHHHHHHhcCCCCCcccHHHHHHHHHHHHHhCCCCCCHHHHHHHHHhhhcEEEeCCceEEcCC
Confidence 7655444 79999999999999999999999999999999999999999999999999999999999999999999998
No 3
>KOG0497 consensus Oxidosqualene-lanosterol cyclase and related proteins [Lipid transport and metabolism]
Probab=100.00 E-value=4.8e-68 Score=507.46 Aligned_cols=228 Identities=66% Similarity=1.279 Sum_probs=222.2
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
||+||+||++||++|+++|+++.-.|.|||.||++||||++ +||+|+|+|+||+|||+||||+|+|+|++
T Consensus 176 mF~TvlNYi~LRilG~~~~~~~~~a~~~aR~wild~GGa~~~p~wgK~wLsvLgvydWsG~np~pPElwllP~~~P~h~g 255 (760)
T KOG0497|consen 176 MFCTVLNYICLRILGEGPDHGDESACKRARKWILDHGGATYIPSWGKFWLSVLGVYDWSGVNPLPPELWLLPSFLPIHPG 255 (760)
T ss_pred EEEeeehheeheeeccCCCCCchhHHHHHHHHHHHcCCccccchhhHHHHHhcccccCcCCCCCCchhhccccccCCCCC
Confidence 69999999999999999998665579999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhh
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPI 150 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~ 150 (228)
++|||+|.||+||+|+|++||+++.+|++.+||+|||++||++|||.++|+.||++|+|+|||.+++.+|+.|+.+.+++
T Consensus 256 ~~w~~~R~vy~pmsYlygkrfv~~~tpli~~LreELy~~py~~Inw~~~Rn~~akeDlyyphs~i~D~l~~~l~~~~e~l 335 (760)
T KOG0497|consen 256 TLWCHCRDVYMPMSYLYGKRFVAPPTPLILQLREELYPEPYDKINWSKARNLCAKEDLYYPHSLLQDLLWALLHKFSEPL 335 (760)
T ss_pred ceEEEecceecccccceeeeeeccCChHHHHHhhhhcCCChhhhhHHHHhhccccccccCCcHHHHHHHHHHHHHHHHhh
Confidence 99999999999999999999999999999999999999999999999999999999999999999999999999999999
Q ss_pred hccCCChHHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccCCCCHHHHHHHhhhccceEecCCceeeeeC
Q 040035 151 LNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIEDPNSDYFKKHLPRIGEYLWVGEDGMKVQVR 228 (228)
Q Consensus 151 ~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~p~sp~~~~~~~~l~~~lw~~~dG~~~q~~ 228 (228)
+++|+.+-+|++|++.++++|+++||+|+|||+|||++++||++||.++|+|..|++|+.|++||+|+++|||+||+.
T Consensus 336 l~rWp~~~~R~~a~~~~me~ihyede~t~yi~ig~v~k~~~ml~cwvedp~s~~Fkkhl~Ri~d~lw~gedGmkmq~~ 413 (760)
T KOG0497|consen 336 LNRWPLKLIREKALRTAMELIHYEDENTRYITIGPVNKAFNMLACWVEDPNSDAFKKHLARIPDFLWIAEDGMKMQGF 413 (760)
T ss_pred hhhhhhHHHHHHHHHHHHHHhhhhhcccCceecccchhhhcceeeeeeccchHHHHHHhccccCeEEEcCCCceEeec
Confidence 999988888999999999999999999999999999999999999999999999999999999999999999999984
No 4
>TIGR03463 osq_cycl 2,3-oxidosqualene cyclase. This model identifies 2,3-oxidosqualene cyclases from Stigmatella aurantiaca which produces cycloartenol, and Gemmata obscuriglobus and Methylococcus capsulatus which each produce the closely related sterol, lanosterol.
Probab=100.00 E-value=3.6e-65 Score=497.65 Aligned_cols=220 Identities=36% Similarity=0.725 Sum_probs=208.0
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhc-CChhh----------hhcccccCCCCCCCCccccCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDR-GGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISP 69 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~-GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~ 69 (228)
||+||+||+||||+|+++|+ |+|+|||+||+++ ||+++ +||+|||+++|+|||||||||+||||||
T Consensus 71 ~~~T~~~Y~aLrl~G~~~~~---~~~~rAr~~i~~~~GG~~~~~~~~k~~La~~g~~~W~~~~~~P~El~lLP~~~P~~~ 147 (634)
T TIGR03463 71 VFTTVLNYVALRLLGVGKED---AGLARARQWLHAQPGGVLGSPTWGKFWLALLGLYGRGGLQPVPPELWLLPESLPFHP 147 (634)
T ss_pred hHHHHHHHHHHHHcCCCCCC---HHHHHHHHHHHhCCCCcccCchHHHHHHHHcCcCCcccCCCCCHHHHHccccCCcCH
Confidence 69999999999999999999 9999999999999 99999 8899999999999999999999999999
Q ss_pred CCcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHh
Q 040035 70 GKLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEP 149 (228)
Q Consensus 70 ~~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~ 149 (228)
|+||||+|+|++||+||+++||+++++|++.+||+|||++||++|||.+.|+.++++|.|.|++++++.+...|. .+++
T Consensus 148 ~~~~~~~R~v~~p~~~l~~~r~~~~~~~~~~~l~~EL~~~~~~~~~~~~~~~~~~~~d~~~p~~~~~~~~~~~l~-~~~~ 226 (634)
T TIGR03463 148 SRFYCHTRMVYLPMSWLYGRRARAPLTPLRAALRQELYDGGYGQVDFVAARERVAPTDVFTPRTFWLRAANQVMY-GYER 226 (634)
T ss_pred HHHHHHhHHHHHhHHHHhcCCcccCCCcchhhhhHHhccCCccccccccccCccccccccCCcHHHHHHHHHHHH-Hhhc
Confidence 999999999999999999999999999999999999999999999999999999999999999977666666653 3333
Q ss_pred hhccCCChHHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccCCCCHHHHHHHhhhccceEecCC-ceeeeeC
Q 040035 150 ILNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIEDPNSDYFKKHLPRIGEYLWVGED-GMKVQVR 228 (228)
Q Consensus 150 ~~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~p~sp~~~~~~~~l~~~lw~~~d-G~~~q~~ 228 (228)
+++++||++|+++|++||++|+|+|||+|++|+++++||+++++++||||.|++|+++|++|+|.++| ||+||+|
T Consensus 227 ----~~~~~lr~~A~~~~~~~i~~~~~~~~~~~i~p~~~~~~~l~~~g~~~~~p~~~k~l~~l~~~~~~~~~~g~~~q~~ 302 (634)
T TIGR03463 227 ----LAGKQLRARALDFCLEQIRAEDEATHYICISPVNGVLNMLAWFAVNPDGPEVAAHLEGLEDYRYEDDDRGLRYNGY 302 (634)
T ss_pred ----cCCHHHHHHHHHHHHHHHHHHhcCCCeEehHHHHHHHHHHHHhCCCCCCHHHHHHHHHHHhhEEEcCCCCEEEeeC
Confidence 25667999999999999999999999999999999999999999999999999999999999999999 9999998
No 5
>cd02892 SQCY_1 Squalene cyclase (SQCY) domain subgroup 1; found in class II terpene cyclases that have an alpha 6 - alpha 6 barrel fold. Squalene cyclase (SQCY) and 2,3-oxidosqualene cyclase (OSQCY) are integral membrane proteins that catalyze a cationic cyclization cascade converting linear triterpenes to fused ring compounds. This group contains bacterial SQCY which catalyzes the convertion of squalene to hopene or diplopterol and eukaryotic OSQCY which transforms the 2,3-epoxide of squalene to compounds such as, lanosterol in mammals and fungi or, cycloartenol in plants. Deletion of a single glycine residue of Alicyclobacillus acidocaldarius SQCY alters its substrate specificity into that of eukaryotic OSQCY. Both enzymes have a second minor domain, which forms an alpha-alpha barrel that is inserted into the major domain.
Probab=100.00 E-value=1.7e-58 Score=451.03 Aligned_cols=216 Identities=48% Similarity=0.910 Sum_probs=197.7
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
||+||+||+||||+|+++|| |+|+|||+||+++||+++ +||+|||+++|+|||||||||+|||||||
T Consensus 75 ~~~T~~~Y~aLrl~G~~~~~---~~m~~Ar~~i~~~GG~~~~~~~~k~~La~~G~~~W~~~~~~P~El~llP~~~p~~~~ 151 (634)
T cd02892 75 MFGTVLNYVALRLLGVSPDD---PHMVKARNWILSHGGAARIPVWGKIWLALLGVYPWEGVPPLPPELWLLPSWLPFHPY 151 (634)
T ss_pred hHHHHHHHHHHHHcCCCCCC---HHHHHHHHHHHHcCCcccccHHHHHHHHHcCccccccCCCCCHhHHhcCCcCCccHH
Confidence 69999999999999999999 999999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhh
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPI 150 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~ 150 (228)
+||||+|+|++||+||+++||++|+++++.++|+|||++||++|+|..+|+ ++.|.+.|+++++..+...+. .++.
T Consensus 152 ~~~~~~R~~~~p~~~l~~~r~~~~~~~~~~~~~~el~~~~~~~~~~~~~~~--~~~~~~~~~~~~~~~~~~~~~-~~~~- 227 (634)
T cd02892 152 KFWCWARTVYVPMSYLYGKRPVAPITPLVLSLRDELYVEPYEKINWYKHRN--DLYDYRPPWQRLFDALDRLLH-WYEP- 227 (634)
T ss_pred HHHHHHHHHHHhHHHHhcCCcccCCCCccccchHHhCCCCccccccccccc--ccccCCCChHHHHHHHHHHHH-HHHh-
Confidence 999999999999999999999999888888899999999999999999998 888888887776665555443 3433
Q ss_pred hccCCChHHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccC-CCCHHHHHHHhhhccceEecCCceeee
Q 040035 151 LNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIED-PNSDYFKKHLPRIGEYLWVGEDGMKVQ 226 (228)
Q Consensus 151 ~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~-p~sp~~~~~~~~l~~~lw~~~dG~~~q 226 (228)
.++++||++|+++|++||++|||+||+.|.+++++++||++++.++ ||||.+++|++++++|+|..+||+.++
T Consensus 228 ---~~~~~lr~~a~~~~~~~i~~~q~~~g~~~~~~~~~~l~~lal~~~g~~~~~~~~~~l~~l~~~~~~~~~g~~~~ 301 (634)
T cd02892 228 ---LPPKPLRRKALRKAYEWILYRDENTGYLGIIPPPKANNMLALWVLGYPDSPAFKRHLERIDDFLWLGPEGMKMC 301 (634)
T ss_pred ---cCcHHHHHHHHHHHHHHHHHHhcCCCceeeeehHHHHHHHHHHHcCCCCCHHHHHHHHHHHhcEEEecCCcEEE
Confidence 2567799999999999999999999999999999999999999666 899999999999999999998887654
No 6
>TIGR01787 squalene_cyclas squalene/oxidosqualene cyclases. This family of enzymes catalyzes the cyclization of the triterpenes squalene or 2-3-oxidosqualene to a variety of products including hopene, lanosterol, cycloartenol, amyrin, lupeol and isomultiflorenol.
Probab=100.00 E-value=1.1e-54 Score=423.35 Aligned_cols=207 Identities=43% Similarity=0.823 Sum_probs=186.9
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
||+||+||+||||+|+++|+ |+|+|||+||+++||+++ +||+|||+++|+|||||||||+|||||++
T Consensus 75 ~~~Tv~aY~aLrl~G~~~~~---~~m~~Ar~~i~~~GG~~~~~~~~k~~La~~G~~~W~~~~~~P~El~llP~~~p~~~~ 151 (621)
T TIGR01787 75 VFGTVLAYVALKILGMSPDD---PAMVRARNFILKQGGAVASPVFTKFWLALLGVYPWEGVPPLPPEIMLLPKWLPIHPS 151 (621)
T ss_pred hHHHHHHHHHHHHcCCCCCc---HHHHHHHHHHHHcCCcccCchHHHHHHHHcCccccccCCCCCHhHHhcCcccCcCcc
Confidence 69999999999999999999 999999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhh
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPI 150 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~ 150 (228)
++|||+|+|++||+|++++|++.++++ |+|||++| +++ .+.|+.++++|.|.|++++.+.+...+. +
T Consensus 152 ~~w~~~~~v~l~~~~~~~~~~~~~~~~-----~~el~~~~-~~~--~~~~~~~~~~~~~~~~~~~~~~~~~~~~-----~ 218 (621)
T TIGR01787 152 KSWCRCRMVYLPMSYCYGERLSAPIDP-----REELYVED-DSI--RAQRNNVAKEDLYTPHSWLLRALYGLLN-----L 218 (621)
T ss_pred hhhhhhhhHHHHHHHHcCccccCCCCc-----chhhcCCC-cch--hhccCCCCcccccccHHHHHHHHHHHHh-----h
Confidence 999999999999999999999998776 59999999 777 3578888999999988876654443321 1
Q ss_pred hccCCChHHHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhccC-CCCHHHHHHHhhhccceEecCCceeeeeC
Q 040035 151 LNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWIED-PNSDYFKKHLPRIGEYLWVGEDGMKVQVR 228 (228)
Q Consensus 151 ~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~~~-p~sp~~~~~~~~l~~~lw~~~dG~~~q~~ 228 (228)
... ..+|+.|+++|++||.+++|.+| |||+|++++||++++.++ ||||.|++|+++|++|+|+++|||+||+|
T Consensus 219 ~~~---~~~~~~a~~~a~~~~~~~~~~~g--~~~~i~~~~~~~al~~~g~~d~p~~~~~l~~l~~~~~~~~dg~~~q~~ 292 (621)
T TIGR01787 219 FYH---PFLRKALRKRALQWLYEHIAADG--SIGPISKAMAMLALWFLDGPNSPAFQKHLQRIDDYLWLQLDGMKMQGT 292 (621)
T ss_pred ccc---ccccHHHHHHHHHHHHHHhccCC--CchhHhHHHHHHHHHHcCCCCCHHHHHHHHHHhhcEEEeCCccEEecC
Confidence 111 12499999999999999999999 999999999999999777 89999999999999999999999999998
No 7
>TIGR01507 hopene_cyclase squalene-hopene cyclase. SHC is an essential prokaryotic gene in hopanoid (triterpenoid) biosynthesis. Squalene hopene cyclase, an integral membrane protein, directly cyclizes squalene into hopanoid products.
Probab=100.00 E-value=1.2e-54 Score=423.59 Aligned_cols=206 Identities=20% Similarity=0.308 Sum_probs=178.3
Q ss_pred CchhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCC
Q 040035 1 MFGTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPG 70 (228)
Q Consensus 1 ~~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~ 70 (228)
||+||+||+|||++|+++|+ |+|+|||+||+++||+++ +||+|||+++|+|||||||||+|||||||
T Consensus 91 ~~~Tv~~Y~aLrl~G~~~~~---~~m~rAr~~I~~~GG~~~~~~~tk~~LAl~G~~~W~~~~~~P~El~llP~~~p~~~~ 167 (635)
T TIGR01507 91 LSTTVEAYVALKYIGMSRDE---PPMQKALRFIQSQGGIESSRVFTRMWLALVGEYPWRGVPMVPPEIMLLPKRFPFNIY 167 (635)
T ss_pred hhHHHHHHHHHHHhCCCCCc---HHHHHHHHHHHHcCCcccccHHHHHHHHHcCCcCcccCCCCCHHHHhCCCcCCccHH
Confidence 79999999999999999999 999999999999999999 88999999999999999999999999999
Q ss_pred CcchhchhhhhhhhhhhcCcccccCCchhHhHH-HhhccCCCCCCCccccccccCCCCCCCCCch-hHHHHHHHHHHHHH
Q 040035 71 KLNCYCRVTYMPMSYLYGKRFVGPITPLILQLR-EEIYTQPYTDIDWSKMRHFCAKEDIFFPHTT-VQNLLWDTLYNVVE 148 (228)
Q Consensus 71 ~~~~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr-~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~-~~~~~~~~l~~~~~ 148 (228)
+||||+|+|++||+||+++||+++++. ++| +|||.+||++ .|+.+++.| ++| ++..+.+.+ ..++
T Consensus 168 ~~~~~~R~~~~P~~~l~~~r~~~~~~~---~~~~~eL~~~~~~~-----~~~~~~~~~----~~~~~~~~~~~~l-~~~~ 234 (635)
T TIGR01507 168 EFSSWARATVVPLSIVCSRKPVFPLPE---RARVPELYETDVPK-----PRRRGAKGG----TGWGIFDALDRAL-HGYE 234 (635)
T ss_pred HHHHHHHHHHHHHHHHhcCCCccCCCc---ccChHhhcCCChHH-----hcccCCccC----CcHHHHHHHHHHH-HHHH
Confidence 999999999999999999999999763 234 9999999854 555566555 245 444444444 3344
Q ss_pred hhhccCCChHHHHHHHHHHHHHHHHHhcCCCccccccccc-hhhhhhhh---ccCCCCHHHHHHHhhhccceEecCCcee
Q 040035 149 PILNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIECVEK-PLNMLCCW---IEDPNSDYFKKHLPRIGEYLWVGEDGMK 224 (228)
Q Consensus 149 ~~~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~-~~nml~~~---~~~p~sp~~~~~~~~l~~~lw~~~dG~~ 224 (228)
+ ..++++|++|+++|++||++|+|+|| ++++|.+ ++|||+++ ++.+|||.++||++++++|+|.++||++
T Consensus 235 ~----l~~~~lr~~A~~~a~~~i~~~~e~~g--~~~~i~p~~~~~l~~l~~~g~~~~~~~~~~~l~~l~~~~~~~~~g~~ 308 (635)
T TIGR01507 235 K----LSVHPFRRAAEIRALDWLLERQAGDG--SWGGIQPAMFNALIALKILGMTQHDAFIKLGWEGIDLYGVELDDSWM 308 (635)
T ss_pred h----cCCcHHHHHHHHHHHHHHHHHHcCCC--ceeecchHHHHHHHHHHHcCCCCCCHHHHHHHHHHHHheEecCCceE
Confidence 3 24567999999999999999999999 6666665 67999999 3448999999999999999999999999
Q ss_pred eeeC
Q 040035 225 VQVR 228 (228)
Q Consensus 225 ~q~~ 228 (228)
+|+|
T Consensus 309 ~~~~ 312 (635)
T TIGR01507 309 FQAC 312 (635)
T ss_pred ecCC
Confidence 9987
No 8
>COG1657 SqhC Squalene cyclase [Lipid metabolism]
Probab=99.76 E-value=2.6e-19 Score=170.16 Aligned_cols=179 Identities=21% Similarity=0.289 Sum_probs=139.4
Q ss_pred HHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCCCcchhchhhh
Q 040035 11 MRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPGKLNCYCRVTY 80 (228)
Q Consensus 11 LrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~~~~~~~R~v~ 80 (228)
||++|++.++ |+|.+||.||..+||+.+ ++|.|.|. +++.|++.|+||.-+|+|+++||||+|.++
T Consensus 1 ~~~~g~~~~~---p~~~~a~~~~~~~gg~~~~~~~~k~~la~~~~y~w~-~~~~p~~~~~lp~~~p~~~~~~~~~~r~~~ 76 (517)
T COG1657 1 LRPLGVPATD---PALLKARSFILWRGGISKSRIWTKCRLAVLGAYIWR-APSAPPWVMLLPNTLPVHFYQMSSWARSST 76 (517)
T ss_pred CCcccCCccc---HHHhccHhhhhhcCCccccchHHHHHHHHhcceeec-cCCCCchHhhCCCcccchHHHHHHHhhhcc
Confidence 5889999999 999999999999999999 78999999 999999999999999999999999999999
Q ss_pred hhhhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCCCCCCCchhHHHHHHHHHHHHHhhhccCCChHHH
Q 040035 81 MPMSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPILNRWPLNKLR 160 (228)
Q Consensus 81 ~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~~~~~~~~~lR 160 (228)
+| ++ .+ .. +++|+.+ +.-.+++.|++.-...++..+....+... ..+..+++
T Consensus 77 ~p--~~---------~~---~~-~~~~~~~------------~~~~~l~yp~~~~~~r~~~~~~~~~~~~~-~~~~~~~~ 128 (517)
T COG1657 77 VP--LI---------AP---AS-DPLLTEG------------VKNVLLLYPTSGDVERLLLLLDHYFKRGF-PAPVTSLR 128 (517)
T ss_pred cc--cc---------cc---cc-ccccccc------------ccceeEEcCCcchHHHHHHHHHHHHhhcc-Cccchhhh
Confidence 99 11 01 11 3444332 23356678887644444445555555443 33566777
Q ss_pred HHHHHHHHHHHHHHhcCCCccccccccchhhhhhhhc-cCCCC-HHHHHHHhhhccceEecCCcee
Q 040035 161 EKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCWI-EDPNS-DYFKKHLPRIGEYLWVGEDGMK 224 (228)
Q Consensus 161 ~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~~-~~p~s-p~~~~~~~~l~~~lw~~~dG~~ 224 (228)
.+ +.++.|+.++|+.+|- +.|+++.++|+.+.+. .+.++ ..|++|..+..++.+....|+-
T Consensus 129 ~~--~~a~l~~~e~Qn~dg~-w~g~v~aa~~~~~~l~~lg~~~~~~~~~~~~~~~~~~~~~~~~~~ 191 (517)
T COG1657 129 VR--KEAELWKLERQNDDGS-WRGIVNAASNVVLSLVVLGLDSNEPFQRRELRAEDSELVKAVGRG 191 (517)
T ss_pred hh--hhhheeeeeecccccc-cccchhhhhHHHHHHHHhhhccchHhhhhhhhhhhhhhhcccccc
Confidence 77 8888999999988773 6777777889888885 34555 8899999999999988777654
No 9
>KOG0497 consensus Oxidosqualene-lanosterol cyclase and related proteins [Lipid transport and metabolism]
Probab=95.46 E-value=0.015 Score=57.82 Aligned_cols=107 Identities=5% Similarity=-0.257 Sum_probs=84.1
Q ss_pred hhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhh----------hhcccccCCCCCCCCccccCCCCCCCCCCCcc
Q 040035 4 TVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMG----------ILGVYDWSGCNPMPPEFWKIPSFLPISPGKLN 73 (228)
Q Consensus 4 Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~----------llG~y~W~~v~~lPpEl~LLP~w~P~~~~~~~ 73 (228)
|..+| +|..+++..+ +.-..++.-+...++... -|-++||...++.++++++++.|++++.|.++
T Consensus 199 ~a~~~--aR~wild~GG---a~~~p~wgK~wLsvLgvydWsG~np~pPElwllP~~~P~h~g~~w~~~R~vy~pmsYlyg 273 (760)
T KOG0497|consen 199 SACKR--ARKWILDHGG---ATYIPSWGKFWLSVLGVYDWSGVNPLPPELWLLPSFLPIHPGTLWCHCRDVYMPMSYLYG 273 (760)
T ss_pred hHHHH--HHHHHHHcCC---ccccchhhHHHHHhcccccCcCCCCCCchhhccccccCCCCCceEEEecceeccccccee
Confidence 56666 7777777666 655555544444444444 56999999999999999999999999999999
Q ss_pred hhchhhhhhhhhhhcCcccccCCchhHhHHHhhccCCCCCCC
Q 040035 74 CYCRVTYMPMSYLYGKRFVGPITPLILQLREEIYTQPYTDID 115 (228)
Q Consensus 74 ~~~R~v~~Pm~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~ 115 (228)
++-+.++.||.+.+.++.-.+.-..+.-.+.+.++..++.+.
T Consensus 274 krfv~~~tpli~~LreELy~~py~~Inw~~~Rn~~akeDlyy 315 (760)
T KOG0497|consen 274 KRFVAPPTPLILQLREELYPEPYDKINWSKARNLCAKEDLYY 315 (760)
T ss_pred eeeeccCChHHHHHhhhhcCCChhhhhHHHHhhccccccccC
Confidence 999999999999999998766455666677888888776654
No 10
>PF13243 Prenyltrans_1: Prenyltransferase-like; PDB: 3SDR_A 3SAE_A 3SDV_A 3SDT_A 3SDQ_A 3SDU_A.
Probab=92.77 E-value=0.091 Score=39.39 Aligned_cols=32 Identities=31% Similarity=0.434 Sum_probs=27.1
Q ss_pred chhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhc
Q 040035 2 FGTVFNYICMRLLGEGPDGGENNACARARKWILDR 36 (228)
Q Consensus 2 ~~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~ 36 (228)
+.|+.++.+|.+.|..+++ +.++||++||+++
T Consensus 74 ~~t~~~~~~l~~~~~~~~~---~~~~r~~~wi~~~ 105 (109)
T PF13243_consen 74 SMTAAAIAALALAGVYPDD---EAVERGLEWILSH 105 (109)
T ss_dssp HHHHHHHHHHHHHHTT--H---HHHHHHHHHHHHH
T ss_pred HHHHHHHHHHHHhCCCCCC---HHHHHHHHHHHHc
Confidence 4678889999999999988 9999999999987
No 11
>COG1657 SqhC Squalene cyclase [Lipid metabolism]
Probab=92.61 E-value=0.08 Score=51.49 Aligned_cols=135 Identities=13% Similarity=0.086 Sum_probs=102.3
Q ss_pred hhcccccC--CCCCCCCccccCCCCCCCCCCCcchhchhhhhhhhhhhcCcccccCC---chhHhHHHhhccCCCCCCCc
Q 040035 42 ILGVYDWS--GCNPMPPEFWKIPSFLPISPGKLNCYCRVTYMPMSYLYGKRFVGPIT---PLILQLREEIYTQPYTDIDW 116 (228)
Q Consensus 42 llG~y~W~--~v~~lPpEl~LLP~w~P~~~~~~~~~~R~v~~Pm~~l~~~r~~~~~~---~~~~~lr~EL~~~p~~~i~w 116 (228)
-++.|.+. +.|.-++.-|||+.+.|...+..+++.+-+|.||..+.+.+...+.. +.+..+++.|........+|
T Consensus 341 a~~~yl~~~~~~~i~~a~e~LL~~Q~~~GsW~g~w~v~~iY~~s~a~~~l~~~g~~~~~~~~v~~~~~~l~~~~~~~~Gw 420 (517)
T COG1657 341 ALNAYLEAYDGQPIERALEWLLSDQEPDGSWYGRWGVCYIYGTSGALSALALVGETDENEVLVRKLISWLVSKQMPDGGW 420 (517)
T ss_pred hhhhccccccCCcccHHHhhhhhhccccCceeeEEEEEEEEehhhhhhhhhccCccccchHHHHHHHHHhhhccccCCCc
Confidence 45888884 67778888999999999999999999999999999999999887633 46777889999888888899
Q ss_pred cccccccCCCCCCCCCchhHHHHHHHHHHHHHhhhccCCChHHHHHHHHHHHHHHHHHhcCCCcccccc
Q 040035 117 SKMRHFCAKEDIFFPHTTVQNLLWDTLYNVVEPILNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIEC 185 (228)
Q Consensus 117 ~~~r~~~~~~d~~~p~~~~~~~~~~~l~~~~~~~~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~ 185 (228)
......++..+.+.+++.+.....+++...+.... + ++.+++.-.++....+|.+| .+.-
T Consensus 421 ~e~~~~~~~~~~~~t~~sl~~~~~wal~~~~~a~~---~----~~~~i~~~~~~~~~~~~~~g--~~~~ 480 (517)
T COG1657 421 GEAKEAISDPVYTGTESSLLVQTNWALIALLTALE---P----NQEAIKPGINLLVSDQEPDG--SWRE 480 (517)
T ss_pred ccccccccccccccccchhhcchhHHHHHHHHhcc---c----chhhhcccccccccCcCCCC--cccc
Confidence 99988888877777766544333333322222211 1 56778888888888888877 4443
No 12
>PLN03012 Camelliol C synthase
Probab=83.09 E-value=1.9 Score=44.03 Aligned_cols=52 Identities=8% Similarity=-0.082 Sum_probs=39.7
Q ss_pred HHHHHHHHHHHHHHhcCCCcccccc---ccc---hhhhhhhh---ccC-CCCHHHHHHHhhhcc
Q 040035 161 EKSLEIAMNHIHYEDEASRYMTIEC---VEK---PLNMLCCW---IED-PNSDYFKKHLPRIGE 214 (228)
Q Consensus 161 ~~Al~~a~~~i~~~~e~t~y~~lg~---i~~---~~nml~~~---~~~-p~sp~~~~~~~~l~~ 214 (228)
+.++++|.+||+..|+.|| +|++ |+. |...|.++ ++. ++++.++|+++=|.+
T Consensus 589 ~~~i~rAv~~L~~~Q~~DG--sW~G~Wgv~y~YgT~~aL~aL~a~g~~~~~~~~Irrav~fLls 650 (759)
T PLN03012 589 NAFIKKAAEYIENIQMLDG--SWYGNWGICFTYGTWFALAGLAAAGKTFNDCEAIRKGVHFLLA 650 (759)
T ss_pred HHHHHHHHHHHHHhcCCCC--CCcccccccCCcHHHHHHHHHHHhCccCCCcHHHHHHHHHHHH
Confidence 6799999999999999999 8988 544 33444444 555 678999999985443
No 13
>cd02897 A2M_2 Proteins similar to alpha2-macroglobulin (alpha (2)-M). This group also contains the pregnancy zone protein (PZP). Alpha(2)-M and PZP are broadly specific proteinase inhibitors. Alpha (2)-M is a major carrier protein in serum. The structural thioester of alpha (2)-M, is involved in the immobilization and entrapment of proteases. PZP is a trace protein in the plasma of non-pregnant females and males which is elevated in pregnancy. Alpha (2)-M and PZ bind to placental protein-14 and may modulate its activity in T-cell growth and cytokine production contributing to fetal survival. It has been suggested that thioester bond cleavage promotes the binding of PZ and alpha (2)-M to the CD91 receptor clearing them from circulation.
Probab=80.87 E-value=2.2 Score=37.85 Aligned_cols=56 Identities=14% Similarity=0.121 Sum_probs=40.5
Q ss_pred HHHHHHHHHHHHHHHHhcCCCcccccccc----------------chhhhhhhh---ccCCCCHHHHHHHhhhccce
Q 040035 159 LREKSLEIAMNHIHYEDEASRYMTIECVE----------------KPLNMLCCW---IEDPNSDYFKKHLPRIGEYL 216 (228)
Q Consensus 159 lR~~Al~~a~~~i~~~~e~t~y~~lg~i~----------------~~~nml~~~---~~~p~sp~~~~~~~~l~~~l 216 (228)
+.+.+++++++|+..+++.+| +|+... .+-+++.++ ++..+++.++++++-|.+..
T Consensus 99 v~~~~i~ra~~wL~~~Q~~dG--~f~~~~~~~~~~~~~~~~~~~~~TA~vl~aL~~~g~~~~~~~i~~a~~yL~~~~ 173 (292)
T cd02897 99 IDENVLQQALTWLSSHQKSNG--CFREVGRVFHKAMQGGVDDEVALTAYVLIALLEAGLPSERPVVEKALSCLEAAL 173 (292)
T ss_pred CCHHHHHHHHHHHHHhcCCCC--CCCCCCcccChhhcCCCCCCcchHHHHHHHHHhcCCccccHHHHHHHHHHHHhc
Confidence 567899999999999999999 877531 122444444 33356888999998776643
No 14
>PF13243 Prenyltrans_1: Prenyltransferase-like; PDB: 3SDR_A 3SAE_A 3SDV_A 3SDT_A 3SDQ_A 3SDU_A.
Probab=79.13 E-value=1.6 Score=32.55 Aligned_cols=50 Identities=10% Similarity=0.080 Sum_probs=27.6
Q ss_pred HHHHHHHHHHHHHhcCCCccccccccc--------hhhhhhhhccCCCCHHHHHHHhhhc
Q 040035 162 KSLEIAMNHIHYEDEASRYMTIECVEK--------PLNMLCCWIEDPNSDYFKKHLPRIG 213 (228)
Q Consensus 162 ~Al~~a~~~i~~~~e~t~y~~lg~i~~--------~~nml~~~~~~p~sp~~~~~~~~l~ 213 (228)
.+++++.+|+..+++.+| +|+-... ++-+++..+..++++.++|+++=|.
T Consensus 46 ~ai~ka~~~l~~~Q~~dG--~w~~~~~~~~~~t~~~~~~l~~~~~~~~~~~~~r~~~wi~ 103 (109)
T PF13243_consen 46 EAIKKAIDWLLSHQNPDG--GWGYSGGEYVSMTAAAIAALALAGVYPDDEAVERGLEWIL 103 (109)
T ss_dssp BSSHHHHHHHHH---TTS----S-TS--HHHHHHHHHHHHHHHHTT--HHHHHHHHHHHH
T ss_pred HHHHHHHHHHHHhcCCCC--CCCCcCCCCHHHHHHHHHHHHHhCCCCCCHHHHHHHHHHH
Confidence 567899999999999999 6764422 1112222245579999999987554
No 15
>PF13249 Prenyltrans_2: Prenyltransferase-like; PDB: 1O6R_B 1O6Q_B 1H35_C 1H3A_C 1SQC_A 1UMP_A 1O6H_C 1O79_B 1GSZ_C 1H37_C ....
Probab=74.91 E-value=0.85 Score=33.97 Aligned_cols=31 Identities=29% Similarity=0.487 Sum_probs=25.5
Q ss_pred hhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhc
Q 040035 3 GTVFNYICMRLLGEGPDGGENNACARARKWILDR 36 (228)
Q Consensus 3 ~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~ 36 (228)
.|..+..+|.++|.+.++ +.++||.+||+++
T Consensus 74 ~t~~~l~~l~~~~~~~~~---~~~~~a~~~l~~~ 104 (113)
T PF13249_consen 74 TTYVALAALELLGRPDDE---EAVRKAVDWLLSC 104 (113)
T ss_dssp HHHHHHHHHHHHT-GGCH---TTHCCHHHHHHHT
T ss_pred HHHHHHHHHHHcCCCccc---HHHHHHHHHHHHh
Confidence 577888899999988775 6899999999984
No 16
>PLN02993 lupeol synthase
Probab=71.84 E-value=6.2 Score=40.48 Aligned_cols=52 Identities=13% Similarity=-0.020 Sum_probs=37.5
Q ss_pred HHHHHHHHHHHHHHhcCCCcccccc---ccc---hhhhhhhh---ccC-CCCHHHHHHHhhhcc
Q 040035 161 EKSLEIAMNHIHYEDEASRYMTIEC---VEK---PLNMLCCW---IED-PNSDYFKKHLPRIGE 214 (228)
Q Consensus 161 ~~Al~~a~~~i~~~~e~t~y~~lg~---i~~---~~nml~~~---~~~-p~sp~~~~~~~~l~~ 214 (228)
+.++++|.+||...|+.+| +|++ ++. |...|.++ ++. ++++.++|+++=|.+
T Consensus 589 ~~~i~rAv~yL~~~Q~~DG--SW~G~Wgv~y~YgT~~aL~aL~a~G~~~~~~~~IrrAv~fLls 650 (763)
T PLN02993 589 IKSIEKAVQFIESKQTPDG--SWYGNWGICFIYATWFALGGLAAAGKTYNDCLAMRKGVHFLLT 650 (763)
T ss_pred HHHHHHHHHHHHHhcCCCC--CcccccccccCcHHHHHHHHHHHcCCCCCCcHHHHHHHHHHHH
Confidence 5789999999999999999 8855 333 33333333 555 456999999985544
No 17
>TIGR03463 osq_cycl 2,3-oxidosqualene cyclase. This model identifies 2,3-oxidosqualene cyclases from Stigmatella aurantiaca which produces cycloartenol, and Gemmata obscuriglobus and Methylococcus capsulatus which each produce the closely related sterol, lanosterol.
Probab=66.87 E-value=10 Score=37.91 Aligned_cols=52 Identities=4% Similarity=0.037 Sum_probs=37.0
Q ss_pred HHHHHHHHHHHHHHhcCCCcccccc----cc--chh---hhhhhhccCCCCHHHHHHHhhhcc
Q 040035 161 EKSLEIAMNHIHYEDEASRYMTIEC----VE--KPL---NMLCCWIEDPNSDYFKKHLPRIGE 214 (228)
Q Consensus 161 ~~Al~~a~~~i~~~~e~t~y~~lg~----i~--~~~---nml~~~~~~p~sp~~~~~~~~l~~ 214 (228)
+.+++++.+|+...|+.+| ++.+ .. .+. ..|...+.+.+++.++|+++-|.+
T Consensus 476 ~~ai~rav~~L~~~Q~~dG--sW~g~Wg~~~~Y~T~~al~aL~~~G~~~~~~~i~rA~~~Ll~ 536 (634)
T TIGR03463 476 TRAISRGVRFLRSRQREDG--SFPGSWGVCFTYGTFHGVMGLRAAGASPDDMALQRAAAWLRS 536 (634)
T ss_pred HHHHHHHHHHHHHhcCCCC--CccccCCCCCcHHHHHHHHHHHHcCCCcCcHHHHHHHHHHHH
Confidence 5689999999999999998 6422 11 123 333334566788999999987765
No 18
>TIGR01507 hopene_cyclase squalene-hopene cyclase. SHC is an essential prokaryotic gene in hopanoid (triterpenoid) biosynthesis. Squalene hopene cyclase, an integral membrane protein, directly cyclizes squalene into hopanoid products.
Probab=64.76 E-value=7.9 Score=38.81 Aligned_cols=30 Identities=30% Similarity=0.586 Sum_probs=28.0
Q ss_pred hhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhc
Q 040035 4 TVFNYICMRLLGEGPDGGENNACARARKWILDR 36 (228)
Q Consensus 4 Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~ 36 (228)
|+.+-.||.-+|+++|+ |.++||.+||+++
T Consensus 319 Ta~ai~AL~~ag~~~~~---p~l~kA~~~L~~~ 348 (635)
T TIGR01507 319 TALAVLALREAGLPADH---DALVKAGEWLLDK 348 (635)
T ss_pred HHHHHHHHHHcCCCCCC---HHHHHHHHHHHhh
Confidence 88999999999998888 9999999999986
No 19
>TIGR01787 squalene_cyclas squalene/oxidosqualene cyclases. This family of enzymes catalyzes the cyclization of the triterpenes squalene or 2-3-oxidosqualene to a variety of products including hopene, lanosterol, cycloartenol, amyrin, lupeol and isomultiflorenol.
Probab=61.09 E-value=11 Score=37.56 Aligned_cols=47 Identities=9% Similarity=-0.081 Sum_probs=34.5
Q ss_pred HHHHHHHHHhcCCCcccccc-------ccchhh---hhhhhccCCCCHHHHHHHhhhcc
Q 040035 166 IAMNHIHYEDEASRYMTIEC-------VEKPLN---MLCCWIEDPNSDYFKKHLPRIGE 214 (228)
Q Consensus 166 ~a~~~i~~~~e~t~y~~lg~-------i~~~~n---ml~~~~~~p~sp~~~~~~~~l~~ 214 (228)
+..+||..+|..|| +||= |+.|.- +|-.+|.++++|.++|+.+-|.+
T Consensus 50 ~~~~~l~~~Q~~DG--gW~~~~~~~~~~~~Tv~aY~aLrl~G~~~~~~~m~~Ar~~i~~ 106 (621)
T TIGR01787 50 KIVRYLRHHQNEDG--GWGLHIGGKSTVFGTVLAYVALKILGMSPDDPAMVRARNFILK 106 (621)
T ss_pred HHHHHHHHhcCCCC--CeeCCcCCCcchHHHHHHHHHHHHcCCCCCcHHHHHHHHHHHH
Confidence 46799999999899 8873 333332 34444888999999999886654
No 20
>cd02892 SQCY_1 Squalene cyclase (SQCY) domain subgroup 1; found in class II terpene cyclases that have an alpha 6 - alpha 6 barrel fold. Squalene cyclase (SQCY) and 2,3-oxidosqualene cyclase (OSQCY) are integral membrane proteins that catalyze a cationic cyclization cascade converting linear triterpenes to fused ring compounds. This group contains bacterial SQCY which catalyzes the convertion of squalene to hopene or diplopterol and eukaryotic OSQCY which transforms the 2,3-epoxide of squalene to compounds such as, lanosterol in mammals and fungi or, cycloartenol in plants. Deletion of a single glycine residue of Alicyclobacillus acidocaldarius SQCY alters its substrate specificity into that of eukaryotic OSQCY. Both enzymes have a second minor domain, which forms an alpha-alpha barrel that is inserted into the major domain.
Probab=49.62 E-value=25 Score=35.06 Aligned_cols=48 Identities=10% Similarity=-0.058 Sum_probs=35.0
Q ss_pred HHHHHHHHHhcCCCcccccccc-------chh-h--hhhhhccCCCCHHHHHHHhhhccc
Q 040035 166 IAMNHIHYEDEASRYMTIECVE-------KPL-N--MLCCWIEDPNSDYFKKHLPRIGEY 215 (228)
Q Consensus 166 ~a~~~i~~~~e~t~y~~lg~i~-------~~~-n--ml~~~~~~p~sp~~~~~~~~l~~~ 215 (228)
...+||..+|..|| +||-+. .|. | +|-.+|+++|+|.++|+.+-|.+-
T Consensus 50 ~~~~~l~~~q~~dG--gw~~~~~~~~~~~~T~~~Y~aLrl~G~~~~~~~m~~Ar~~i~~~ 107 (634)
T cd02892 50 EIARYLRNHQNPDG--GWGLHHEGPSTMFGTVLNYVALRLLGVSPDDPHMVKARNWILSH 107 (634)
T ss_pred HHHHHHHHhccCCC--CccCCCCCCcchHHHHHHHHHHHHcCCCCCCHHHHHHHHHHHHc
Confidence 46799999999998 776442 233 2 344458889999999998876653
No 21
>PF08102 Antimicrobial_7: Scorpion antimicrobial peptide ; InterPro: IPR012526 This family consists of antimicrobial peptides secreted by scorpions. Novel antimicrobial peptides have been isolated from scorpions, namely the opistoporin [] and the pandinin []. These peptides form essentially helical structures and demonstrate high antimicrobial activity against Gram-negative and Gram-positive bacteria respectively.; GO: 0005576 extracellular region
Probab=45.35 E-value=59 Score=21.03 Aligned_cols=38 Identities=26% Similarity=0.400 Sum_probs=24.7
Q ss_pred HHHHHHHHHhhhccCCChHHHHHHHHHHHHHHHHHhcC
Q 040035 140 WDTLYNVVEPILNRWPLNKLREKSLEIAMNHIHYEDEA 177 (228)
Q Consensus 140 ~~~l~~~~~~~~~~~~~~~lR~~Al~~a~~~i~~~~e~ 177 (228)
|+.+-....+..++-+.+.||++|+..|.+|.-+.+..
T Consensus 4 wd~IK~~Akk~wnS~~~~~Lk~kalnAaknfVaeKiGa 41 (43)
T PF08102_consen 4 WDWIKSTAKKAWNSDPVQQLKNKALNAAKNFVAEKIGA 41 (43)
T ss_pred HHHHHHHHHHHhcchHHHHHHHHHHHHHHHHHHHHhCC
Confidence 33343334444334356779999999999999876543
No 22
>PF00432 Prenyltrans: Prenyltransferase and squalene oxidase repeat This Prosite family is a subset of the Pfam family.; InterPro: IPR001330 The beta subunit of the farnesyltransferases is responsible for peptide binding. Squalene-hopene cyclase is a bacterial enzyme that catalyzes the cyclization of squalene into hopene, a key step in hopanoid (triterpenoid) metabolism []. Lanosterol synthase (5.4.99.7 from EC) (oxidosqualene-lanosterol cyclase) catalyzes the cyclization of (S)-2,3-epoxysqualene to lanosterol, the initial precursor of cholesterol, steroid hormones and vitamin D in vertebrates and of ergosterol in fungi []. Cycloartenol synthase () (2,3-epoxysqualene-cycloartenol cyclase) is a plant enzyme that catalyzes the cyclization of (S)-2,3-epoxysqualene to cycloartenol.; GO: 0003824 catalytic activity; PDB: 2IEJ_B 1LD7_B 1LD8_B 2H6G_B 1TN6_B 1S63_B 1MZC_B 2H6I_B 2H6F_B 1JCQ_B ....
Probab=38.46 E-value=32 Score=21.70 Aligned_cols=21 Identities=5% Similarity=-0.037 Sum_probs=17.9
Q ss_pred HHHHHHHHHHHhcCCCccccccc
Q 040035 164 LEIAMNHIHYEDEASRYMTIECV 186 (228)
Q Consensus 164 l~~a~~~i~~~~e~t~y~~lg~i 186 (228)
++++.+||+.++..+| +|+.-
T Consensus 3 ~~~~~~~l~~~Q~~dG--Gf~~~ 23 (44)
T PF00432_consen 3 VEKLIRFLLSCQNPDG--GFGGR 23 (44)
T ss_dssp HHHHHHHHHHTBBTTS--SBBSS
T ss_pred HHHHHHHHHHHCCCCC--CCCCC
Confidence 4678899999999999 88764
No 23
>KOG1062 consensus Vesicle coat complex AP-1, gamma subunit [Intracellular trafficking, secretion, and vesicular transport]
Probab=35.19 E-value=56 Score=33.83 Aligned_cols=45 Identities=22% Similarity=0.359 Sum_probs=32.1
Q ss_pred HHHHHHHHhhhccCCChHHHHHHHHHHHHHHHHHhcCCCcccccc
Q 040035 141 DTLYNVVEPILNRWPLNKLREKSLEIAMNHIHYEDEASRYMTIEC 185 (228)
Q Consensus 141 ~~l~~~~~~~~~~~~~~~lR~~Al~~a~~~i~~~~e~t~y~~lg~ 185 (228)
.+|+..+..++.-.+-+.||..|++-.-+|+..+|.|..|++|-.
T Consensus 292 AILYE~V~TI~~I~~~~~LrvlainiLgkFL~n~d~NirYvaLn~ 336 (866)
T KOG1062|consen 292 AILYECVRTIMDIRSNSGLRVLAINILGKFLLNRDNNIRYVALNM 336 (866)
T ss_pred HHHHHHHHHHHhccCCchHHHHHHHHHHHHhcCCccceeeeehhh
Confidence 344444444332224567999999999999999999999876543
No 24
>PF08157 NUC129: NUC129 domain; InterPro: IPR012579 This C-terminal domain is found in a novel family of hypothetical nucleolar proteins [].; GO: 0005634 nucleus
Probab=34.63 E-value=10 Score=26.53 Aligned_cols=26 Identities=23% Similarity=0.385 Sum_probs=17.4
Q ss_pred HHHHHHhCCCCCCCCcHHHHHHHHHHHhc
Q 040035 8 YICMRLLGEGPDGGENNACARARKWILDR 36 (228)
Q Consensus 8 Y~ALrllG~~~d~~~~p~m~rAR~~Il~~ 36 (228)
|+|.||=+.+.-+ -+-+.|+.||++.
T Consensus 1 Y~a~rlKd~~l~~---~~QqaAk~Fi~~~ 26 (63)
T PF08157_consen 1 YTAVRLKDQSLRD---SQQQAAKDFIQSR 26 (63)
T ss_pred CeeEEeccchhhh---HHHHHHHHHHHHh
Confidence 5555665555555 6778888888874
No 25
>cd02889 SQCY Squalene cyclase (SQCY) domain; found in class II terpene cyclases that have an alpha 6 - alpha 6 barrel fold. Squalene cyclase (SQCY) and 2,3-oxidosqualene cyclase (OSQCY) are integral membrane proteins that catalyze a cationic cyclization cascade converting linear triterpenes to fused ring compounds. Bacterial SQCY catalyzes the convertion of squalene to hopene or diplopterol. Eukaryotic OSQCY transforms the 2,3-epoxide of squalene to compounds such as, lanosterol (a metabolic precursor of cholesterol and steroid hormones) in mammals and fungi or, cycloartenol in plants. Deletion of a single glycine residue of Alicyclobacillus acidocaldarius SQCY alters its substrate specificity into that of eukaryotic OSQCY. Both enzymes have a second minor domain, which forms an alpha-alpha barrel that is inserted into the major domain. This group also contains SQCY-like archael sequences and some bacterial SQCY's which lack this minor domain.
Probab=31.97 E-value=60 Score=29.00 Aligned_cols=33 Identities=18% Similarity=0.249 Sum_probs=27.1
Q ss_pred chhhHHHHHHHHhCC-CCCCCCcHHHHHHHHHHHhcC
Q 040035 2 FGTVFNYICMRLLGE-GPDGGENNACARARKWILDRG 37 (228)
Q Consensus 2 ~~Tv~aY~ALrllG~-~~d~~~~p~m~rAR~~Il~~G 37 (228)
..|.++-.||...|. ++.. +.++||.+||++++
T Consensus 26 ~~Ta~~~~al~~~g~~~~~~---~~~~ka~~~l~~~q 59 (348)
T cd02889 26 WDTALALQALLEAGLAPEFD---PALKKALEWLLKSQ 59 (348)
T ss_pred HHHHHHHHHHHHcCCCCccC---HHHHHHHHHHHhcC
Confidence 468888888888887 3445 78999999999987
No 26
>PRK14388 hypothetical protein; Provisional
Probab=31.29 E-value=80 Score=23.44 Aligned_cols=39 Identities=23% Similarity=0.383 Sum_probs=29.5
Q ss_pred HHHHHHHHhcCChhh-------hhcccccC--CCCCCCCccccCCCCCCCC
Q 040035 27 ARARKWILDRGGAMG-------ILGVYDWS--GCNPMPPEFWKIPSFLPIS 68 (228)
Q Consensus 27 ~rAR~~Il~~GGa~~-------llG~y~W~--~v~~lPpEl~LLP~w~P~~ 68 (228)
+=|.+.|..+|-..+ ++-.-||. |..|||++ ...|.|+|
T Consensus 32 ~Ya~~Ai~~~G~~kG~~l~~~RilRC~P~~~gG~DpVP~~---~~~~~~~~ 79 (82)
T PRK14388 32 EYAKEAISMHGSIKGLWFTFKRIIKCQPFCDGGYDTVPIS---IKNSKPLN 79 (82)
T ss_pred HHHHHHHHHhCcHHHHHHHHHHHhcCCCCCCCCcCCCCCc---ccCCCCcc
Confidence 447888999998877 77777775 57888875 56688776
No 27
>cd03381 PAP2_glucose_6_phosphatase PAP2_like proteins, glucose-6-phosphatase subfamily. Glucose-6-phosphatase converts glucose-6-phosphate into free glucose and is active in the lumen of the endoplasmic reticulum, where it is bound to the membrane. The generation of free glucose is an important control point in metabolism, and stands at the end of gluconeogenesis and the release of glucose from glycogen. Deficiency of glucose-6-phosphatase leads to von Gierke's disease.
Probab=31.29 E-value=36 Score=29.92 Aligned_cols=24 Identities=25% Similarity=0.346 Sum_probs=20.7
Q ss_pred hHHHHHHHHhCCCCCCCCcHHHHHHHHH
Q 040035 5 VFNYICMRLLGEGPDGGENNACARARKW 32 (228)
Q Consensus 5 v~aY~ALrllG~~~d~~~~p~m~rAR~~ 32 (228)
+--|+.||.+|+|+.= .++||.+|
T Consensus 176 ~~~y~~~~~~gvd~~w----s~~~a~kw 199 (235)
T cd03381 176 LGFYLLLKWLGVDLLW----SLEKAFKW 199 (235)
T ss_pred HHHHHHHHHhCCCchh----hHHHHHhc
Confidence 4459999999999986 69999987
No 28
>PF04000 Sas10_Utp3: Sas10/Utp3/C1D family; InterPro: IPR007146 This family contains Utp3 and LCP5 which are components of the U3 ribonucleoprotein complex []. It also includes the Homo sapiens (Human) C1D protein and Saccharomyces cerevisiae (Baker's yeast) YHR081W (rrp47), an exosome-associated protein required for the 3' processing of stable RNAs [] and Sas10 which has been identified as a regulator of chromatin silencing []. This entry also includes the human protein Neuroguidin, an initiation factor 4E (eIF4E)-binding protein [].
Probab=31.09 E-value=55 Score=23.09 Aligned_cols=24 Identities=17% Similarity=0.368 Sum_probs=16.9
Q ss_pred hhhHHHHHHHHhCCCCCCCCcHHHHH
Q 040035 3 GTVFNYICMRLLGEGPDGGENNACAR 28 (228)
Q Consensus 3 ~Tv~aY~ALrllG~~~d~~~~p~m~r 28 (228)
.+..-|++||..|.++++ .|.|.+
T Consensus 52 ~~~~~~~~lk~~g~~~~~--hpv~~~ 75 (85)
T PF04000_consen 52 INLLFYMYLKLSGVDPKD--HPVMKE 75 (85)
T ss_pred HHHHHHHHHHhCCCCCCC--ChHHHH
Confidence 356779999999977664 166544
No 29
>PF11352 DUF3155: Protein of unknown function (DUF3155); InterPro: IPR021498 This family of proteins with unknown function appears to be restricted to Cyanobacteria.
Probab=28.31 E-value=36 Score=25.30 Aligned_cols=20 Identities=30% Similarity=0.632 Sum_probs=15.2
Q ss_pred CCCCcHHHHHHHHHHHhcCC
Q 040035 19 DGGENNACARARKWILDRGG 38 (228)
Q Consensus 19 d~~~~p~m~rAR~~Il~~GG 38 (228)
+.|++.....||+||++.|=
T Consensus 27 e~ge~KpVTAARrfI~~~~i 46 (90)
T PF11352_consen 27 ESGEDKPVTAARRFIAENGI 46 (90)
T ss_pred ccCCCCccHHHHHHHHHcCC
Confidence 33444679999999999864
No 30
>COG5507 Uncharacterized conserved protein [Function unknown]
Probab=27.02 E-value=26 Score=27.11 Aligned_cols=26 Identities=23% Similarity=0.669 Sum_probs=18.7
Q ss_pred hhhhhhhhccC-CCCHH--HHHHHhhhcc
Q 040035 189 PLNMLCCWIED-PNSDY--FKKHLPRIGE 214 (228)
Q Consensus 189 ~~nml~~~~~~-p~sp~--~~~~~~~l~~ 214 (228)
+++++-||+.+ |.... |+++++.-+|
T Consensus 35 al~~VEc~~dDVP~Gk~T~F~rAVkA~dd 63 (117)
T COG5507 35 ALRYVECWADDVPYGKLTDFPRAVKAKDD 63 (117)
T ss_pred chhhhhhcccCCCCCcccchhhhhhccCC
Confidence 67788888777 65554 8888776555
No 31
>cd02897 A2M_2 Proteins similar to alpha2-macroglobulin (alpha (2)-M). This group also contains the pregnancy zone protein (PZP). Alpha(2)-M and PZP are broadly specific proteinase inhibitors. Alpha (2)-M is a major carrier protein in serum. The structural thioester of alpha (2)-M, is involved in the immobilization and entrapment of proteases. PZP is a trace protein in the plasma of non-pregnant females and males which is elevated in pregnancy. Alpha (2)-M and PZ bind to placental protein-14 and may modulate its activity in T-cell growth and cytokine production contributing to fetal survival. It has been suggested that thioester bond cleavage promotes the binding of PZ and alpha (2)-M to the CD91 receptor clearing them from circulation.
Probab=25.73 E-value=91 Score=27.46 Aligned_cols=144 Identities=10% Similarity=0.052 Sum_probs=74.9
Q ss_pred hhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhcCChhhhhcccccCCCCCCCCccccCCCCCCCCCCCcchhchhhhhh
Q 040035 3 GTVFNYICMRLLGEGPDGGENNACARARKWILDRGGAMGILGVYDWSGCNPMPPEFWKIPSFLPISPGKLNCYCRVTYMP 82 (228)
Q Consensus 3 ~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~GGa~~llG~y~W~~v~~lPpEl~LLP~w~P~~~~~~~~~~R~v~~P 82 (228)
.|+.+-.||.-.|.+.++ +.+.||.+||.++=-- .-..|...+..-
T Consensus 142 ~TA~vl~aL~~~g~~~~~---~~i~~a~~yL~~~~~~-------------------------------~~~~y~~al~a~ 187 (292)
T cd02897 142 LTAYVLIALLEAGLPSER---PVVEKALSCLEAALDS-------------------------------ISDPYTLALAAY 187 (292)
T ss_pred hHHHHHHHHHhcCCcccc---HHHHHHHHHHHHhccc-------------------------------CCCHHHHHHHHH
Confidence 477778888888987777 8999999999874110 013455555444
Q ss_pred hhhhhcCcccccCCchhHhHHHhhccCCCCCCCccccccccCCCC-CCCC--C-chhHHHHHHHHHHHHHhhhccCCChH
Q 040035 83 MSYLYGKRFVGPITPLILQLREEIYTQPYTDIDWSKMRHFCAKED-IFFP--H-TTVQNLLWDTLYNVVEPILNRWPLNK 158 (228)
Q Consensus 83 m~~l~~~r~~~~~~~~~~~lr~EL~~~p~~~i~w~~~r~~~~~~d-~~~p--~-~~~~~~~~~~l~~~~~~~~~~~~~~~ 158 (228)
-+-+.+ ... .......+ .++-....+..+|..... ...+ .|.+ . +.+-...+..+. .++. . + .
T Consensus 188 AL~~~~-~~~--~~~~~~~l-~~~~~~~~~~~~W~~~~~--~~~~~~~~~~~~~~~ve~TAyaLla-ll~~---~-~-~- 254 (292)
T cd02897 188 ALTLAG-SEK--RPEALKKL-DELAISEDGTKHWSRPPP--SEEGPSYYWQAPSAEVEMTAYALLA-LLSA---G-G-E- 254 (292)
T ss_pred HHHHcC-Ccc--HHHHHHHH-HHHHhccCCCCCCCcCCC--cccccccCCCCCcchHHHHHHHHHH-HHHc---C-C-c-
Confidence 444444 111 11222333 333333333455643210 1111 0111 1 112233333331 1111 1 1 1
Q ss_pred HHHHHHHHHHHHHHHHhcCCCccccccccchhhhhhhh
Q 040035 159 LREKSLEIAMNHIHYEDEASRYMTIECVEKPLNMLCCW 196 (228)
Q Consensus 159 lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~~nml~~~ 196 (228)
...+..++.+|+...++.+| +|++-+-++..|-++
T Consensus 255 -~~~~~~~~v~WL~~~q~~~G--gf~sTQdt~~al~AL 289 (292)
T cd02897 255 -DLAEALPIVKWLAKQRNSLG--GFSSTQDTVVALQAL 289 (292)
T ss_pred -cHhHHHHHHHHHHHcCCCCC--CcccHHHHHHHHHHH
Confidence 11455667899999888888 899888777666554
No 32
>PF13153 DUF3985: Protein of unknown function (DUF3985)
Probab=24.62 E-value=46 Score=21.40 Aligned_cols=10 Identities=20% Similarity=0.800 Sum_probs=8.0
Q ss_pred HHHHHHHHhC
Q 040035 6 FNYICMRLLG 15 (228)
Q Consensus 6 ~aY~ALrllG 15 (228)
.+|+|||++.
T Consensus 19 vayvalkila 28 (44)
T PF13153_consen 19 VAYVALKILA 28 (44)
T ss_pred HHHHHHHHHH
Confidence 4799999874
No 33
>cd02889 SQCY Squalene cyclase (SQCY) domain; found in class II terpene cyclases that have an alpha 6 - alpha 6 barrel fold. Squalene cyclase (SQCY) and 2,3-oxidosqualene cyclase (OSQCY) are integral membrane proteins that catalyze a cationic cyclization cascade converting linear triterpenes to fused ring compounds. Bacterial SQCY catalyzes the convertion of squalene to hopene or diplopterol. Eukaryotic OSQCY transforms the 2,3-epoxide of squalene to compounds such as, lanosterol (a metabolic precursor of cholesterol and steroid hormones) in mammals and fungi or, cycloartenol in plants. Deletion of a single glycine residue of Alicyclobacillus acidocaldarius SQCY alters its substrate specificity into that of eukaryotic OSQCY. Both enzymes have a second minor domain, which forms an alpha-alpha barrel that is inserted into the major domain. This group also contains SQCY-like archael sequences and some bacterial SQCY's which lack this minor domain.
Probab=22.10 E-value=1.2e+02 Score=27.13 Aligned_cols=31 Identities=26% Similarity=0.507 Sum_probs=25.9
Q ss_pred hhhHHHHHHHHhCCCCCCCCcHHHHHHHHHHHhc
Q 040035 3 GTVFNYICMRLLGEGPDGGENNACARARKWILDR 36 (228)
Q Consensus 3 ~Tv~aY~ALrllG~~~d~~~~p~m~rAR~~Il~~ 36 (228)
+|+.+-.||..+|.+..+ +...+|.+||+++
T Consensus 221 ~ta~a~~aL~~~g~~~~~---~~~~~~~~~L~~~ 251 (348)
T cd02889 221 GTWFALEALAAAGEDENS---PYVRKACDWLLSK 251 (348)
T ss_pred HHHHHHHHHHHcCCCcCc---HHHHHHHHHHHHc
Confidence 577778889999987667 8899999999975
No 34
>PF01122 Cobalamin_bind: Eukaryotic cobalamin-binding protein; InterPro: IPR002157 Cobalamin (Cbl or vitamin B12) is only accessible through diet in mammals. Absorption, plasma transport and cellular uptake of Cbl in mammals involves three Cbl-transporting proteins, which are listed below in order of increasing Cbl-specificity: Haptocorrin (cobalophilin), which binds Cbl and Cbl-derivatives such as cobinamide; it may play a role in preventing the absorption of cobalamin analogues produced by bacteria. Transcobalamin (TC), which transport Cbl from blood to cells. Intrinsic factor (IF), which promotes Cbl absorption in the ileum by specific receptor-mediated endocytosis. The structure of TC reveals a two-domain structure, an N-terminal alpha(6)-alpha(6) barrel, and a smaller C-terminal domain []. Many interactions between Cbl and its binding site in the interface of the two domains are conserved among the other Cbl transporters. Specificity for Cbl between the different transporters may reside in a beta-hairpin motif found in the smaller C-terminal domain []. ; GO: 0031419 cobalamin binding, 0015889 cobalamin transport; PDB: 3KQ4_A 2PMV_A 2BB5_A 2V3N_A 2BBC_A 2BB6_D 2V3P_A.
Probab=20.62 E-value=1.5e+02 Score=27.52 Aligned_cols=53 Identities=9% Similarity=0.076 Sum_probs=33.7
Q ss_pred HHHHHHHHHHHHHHHHhcCCCccccccccch---hhhhhhhccCCC--CHHHHHHHhhhc
Q 040035 159 LREKSLEIAMNHIHYEDEASRYMTIECVEKP---LNMLCCWIEDPN--SDYFKKHLPRIG 213 (228)
Q Consensus 159 lR~~Al~~a~~~i~~~~e~t~y~~lg~i~~~---~nml~~~~~~p~--sp~~~~~~~~l~ 213 (228)
.=+.|+++..+.|..++..+| -||-+++| |-+|.+....+. .-...++++.+-
T Consensus 212 ~i~~~i~~~~~kIl~~q~~~G--~~GNiySTglAmQAL~~~~~~~~~~~w~C~k~~~~ll 269 (326)
T PF01122_consen 212 RIQQAIRSLVEKILSQQKPNG--LFGNIYSTGLAMQALSVSPSPPSESEWNCQKALDALL 269 (326)
T ss_dssp HHHHHHHHHHHHHHHTB-TTS---BSSTTTHHHHHHHHTT-SS-SSHHHHHHHHHHHHHH
T ss_pred HHHHHHHHHHHHHHHhcCCCC--cccchhhHHHHHHHHhcCCCCCcchhhHHHHHHHHHH
Confidence 446789999999999999999 68888884 444444444333 244666666553
Done!