Query 041188
Match_columns 409
No_of_seqs 232 out of 745
Neff 5.9
Searched_HMMs 46136
Date Fri Mar 29 04:38:17 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/041188.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/041188hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 COG2335 Secreted and surface p 99.8 3.9E-20 8.4E-25 169.8 8.1 115 68-195 56-183 (187)
2 COG2335 Secreted and surface p 99.7 8.4E-18 1.8E-22 154.5 10.3 122 234-366 47-185 (187)
3 smart00554 FAS1 Four repeated 99.7 7.5E-18 1.6E-22 139.2 6.3 90 96-194 1-99 (99)
4 PF02469 Fasciclin: Fasciclin 99.7 7.1E-18 1.5E-22 144.8 5.3 115 71-193 2-128 (128)
5 KOG1437 Fasciclin and related 99.7 1.5E-16 3.3E-21 170.4 16.5 247 60-364 373-643 (682)
6 smart00554 FAS1 Four repeated 99.6 1.6E-16 3.4E-21 131.3 5.6 86 267-363 1-99 (99)
7 PF02469 Fasciclin: Fasciclin 99.6 4.2E-15 9.1E-20 127.6 6.0 107 245-361 2-126 (128)
8 KOG1437 Fasciclin and related 99.4 1.1E-12 2.4E-17 141.0 10.1 226 90-363 268-507 (682)
9 PF07172 GRP: Glycine rich pro 36.8 37 0.0008 28.5 3.0 25 5-30 3-28 (95)
10 PLN03132 NADH dehydrogenase (u 17.9 1.6E+02 0.0034 31.6 4.3 19 62-80 50-68 (461)
No 1
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.81 E-value=3.9e-20 Score=169.80 Aligned_cols=115 Identities=23% Similarity=0.349 Sum_probs=97.7
Q ss_pred HhcCcHHHHHHhhccCcccccccCCCCeEEEeeCChhhhcCCC------------CChhHHhhhcccCCccchHHHhccc
Q 041188 68 SHLGFNELATAAPSLSNDAVATSWSGPSTLFAPSDSSLHTCFS------------CSVPSLLREHLVPGLFTIDYLRKLA 135 (409)
Q Consensus 68 ~~~Gft~la~lL~~~~~~~~~l~~~g~~TIFAPtD~AF~~l~~------------~~L~~LL~yHVvpg~~~~~~L~~l~ 135 (409)
...-|++|..+++.++ +-+++.+.|+||||||+|+||++++. ..|.++|.|||++|+++.+++.+.
T Consensus 56 ~~~~f~tl~~a~~aa~-Lv~~L~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk~~~~~l~~~- 133 (187)
T COG2335 56 NNPSFTTLVAALKAAG-LVDTLNETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGKITAADLKSS- 133 (187)
T ss_pred cCcchHHHHHHHHhhh-hHHHhcCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCcccHHHhhcc-
Confidence 3344999999999998 44667889999999999999999984 247889999999999999999863
Q ss_pred CCCeeeccCCCceEEEeeCCCCccccceEEEccEEEeCcccc-cCCceEEEEecCccCCCC
Q 041188 136 FGTKIESLSPGRCITITSSKSENDTVSKVFIGGVEITHPDLF-NNGIIIIHGIQGYISPLS 195 (409)
Q Consensus 136 ~g~~i~Tll~g~~L~Vt~~~~~~~~~~~v~Vnga~Vt~~Di~-~ng~~VIH~ID~VL~P~~ 195 (409)
..+.| +.|..++|...+ ++++||+++|+.+|+. .|| |||+||+||.|+.
T Consensus 134 --~~v~t-~~G~~~~i~~~~------~~~~Vn~a~v~~~di~a~Ng--vIhvID~Vl~Pp~ 183 (187)
T COG2335 134 --GSVKT-VQGADLKIKVTG------GGVYVNDATVTIADINASNG--VIHVIDKVLIPPM 183 (187)
T ss_pred --cccee-ecCceEEEEEcC------CcEEEeeeEEEeccEeccCc--EEEEEeeeccCCC
Confidence 35666 489999998776 4599999999999986 455 9999999999985
No 2
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.74 E-value=8.4e-18 Score=154.45 Aligned_cols=122 Identities=21% Similarity=0.352 Sum_probs=98.3
Q ss_pred HHHHHHHH-HhcChhHHHHHHHHh-H-HHHhccCCcEEEecCccccccCC------------cccc-ccceeeeecCccc
Q 041188 234 LRDAMLRL-RNNGYSILSLAMKVK-Y-QELINLANMTVFALDDVSIFSGS------------YTYI-SNVRFHIIPNRYL 297 (409)
Q Consensus 234 ~~~~~~~L-~~~gfs~~a~lL~~~-l-~~l~~~~~~TVFAPtD~Af~~~~------------~~~l-~iL~yHVVpg~~L 297 (409)
.+++++.. ....|+++..+++.. | +.+...++||||||+|+||.++. .+++ ++|.||||+|+ +
T Consensus 47 ~~~iV~~a~~~~~f~tl~~a~~aa~Lv~~L~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk-~ 125 (187)
T COG2335 47 RADIVESAANNPSFTTLVAALKAAGLVDTLNETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGK-I 125 (187)
T ss_pred hhHHHHHHccCcchHHHHHHHHhhhhHHHhcCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCc-c
Confidence 34567754 556699999998854 5 55788899999999999997652 3455 89999999999 5
Q ss_pred ChhhhccCCCCcccccccCCceEEEEEcCCcccccceEEccEEEecCceeecCCeEEEEec-CcCCCCCC
Q 041188 298 TIGDLERLPVGTTLPTLARGQSLTVTTAGGASVTAPLRINYVRVKVPDVMKNLKIVVHGIY-LPFPHLHP 366 (409)
Q Consensus 298 ~~~dL~~l~~g~~l~TLl~g~~L~vt~~~g~~~~~~l~VN~a~Vv~pDi~~~~~~VVHgId-~l~p~~~~ 366 (409)
+.+|+.+ .....|+ +|..+.|...+++ ++||.++|+.+|+..+| ||||.|| +++|+...
T Consensus 126 ~~~~l~~---~~~v~t~-~G~~~~i~~~~~~-----~~Vn~a~v~~~di~a~N-gvIhvID~Vl~Pp~~~ 185 (187)
T COG2335 126 TAADLKS---SGSVKTV-QGADLKIKVTGGG-----VYVNDATVTIADINASN-GVIHVIDKVLIPPMDL 185 (187)
T ss_pred cHHHhhc---cccceee-cCceEEEEEcCCc-----EEEeeeEEEeccEeccC-cEEEEEeeeccCCCcc
Confidence 8888854 4457787 7889999988777 99999999999997765 6999999 88888754
No 3
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.72 E-value=7.5e-18 Score=139.18 Aligned_cols=90 Identities=27% Similarity=0.425 Sum_probs=76.2
Q ss_pred EEEeeCChhhhcCCCC---------ChhHHhhhcccCCccchHHHhcccCCCeeeccCCCceEEEeeCCCCccccceEEE
Q 041188 96 TLFAPSDSSLHTCFSC---------SVPSLLREHLVPGLFTIDYLRKLAFGTKIESLSPGRCITITSSKSENDTVSKVFI 166 (409)
Q Consensus 96 TIFAPtD~AF~~l~~~---------~L~~LL~yHVvpg~~~~~~L~~l~~g~~i~Tll~g~~L~Vt~~~~~~~~~~~v~V 166 (409)
|||||+|+||++++.. .++++|+||++|+++..++|.+ +..++|+. |..++++..+. .+.+++
T Consensus 1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~~~~~~l~~---~~~~~Tl~-g~~l~v~~~~~----~~~i~i 72 (99)
T smart00554 1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGRLSSADLLN---GGTLPTLA-GSKLRVTRSGD----SGTVTV 72 (99)
T ss_pred CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCceEcHHHhcc---CCccccCC-CCEEEEEEeCC----CCeEEE
Confidence 8999999999987641 5789999999999999999986 56788874 88899987651 268999
Q ss_pred ccEEEeCcccccCCceEEEEecCccCCC
Q 041188 167 GGVEITHPDLFNNGIIIIHGIQGYISPL 194 (409)
Q Consensus 167 nga~Vt~~Di~~ng~~VIH~ID~VL~P~ 194 (409)
|+++|+.+|+..+ +|+||+||+||.|+
T Consensus 73 n~~~v~~~di~~~-nGvih~Id~vL~P~ 99 (99)
T smart00554 73 NGARIVEADIAAT-NGVVHVIDRVLLPP 99 (99)
T ss_pred cceEEEECCEecC-CeEEEEECceeCCC
Confidence 9999999999752 35999999999985
No 4
>PF02469 Fasciclin: Fasciclin domain; InterPro: IPR000782 The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria []. The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein. FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains. Proteins known to contain a FAS1 domain include: Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) []. The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.71 E-value=7.1e-18 Score=144.84 Aligned_cols=115 Identities=24% Similarity=0.366 Sum_probs=87.6
Q ss_pred CcHHHHHHhhccCcccccc-cCCCCeEEEeeCChhhhcCCC----------CChhHHhhhcccCCccchHHHhcccCCCe
Q 041188 71 GFNELATAAPSLSNDAVAT-SWSGPSTLFAPSDSSLHTCFS----------CSVPSLLREHLVPGLFTIDYLRKLAFGTK 139 (409)
Q Consensus 71 Gft~la~lL~~~~~~~~~l-~~~g~~TIFAPtD~AF~~l~~----------~~L~~LL~yHVvpg~~~~~~L~~l~~g~~ 139 (409)
.|+.|+++|+.+++. +.+ ...+++|||||+|+||++++. ..+.++|+||++++.+..++|... ...
T Consensus 2 ~~s~f~~~l~~~~l~-~~l~~~~~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~~~~~~l~~~--~~~ 78 (128)
T PF02469_consen 2 DLSTFSRLLEQAGLA-DLLNDSDGNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGSITSSDLRNG--KQT 78 (128)
T ss_dssp TTHHHHHHHHHTTCH-HHHGCSSSSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES---HCHHHCH--HEE
T ss_pred CHHHHHHHHHHcCCH-HHHhcCCCCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCceehhhhccc--ccc
Confidence 477888888888744 444 566899999999999987742 247899999999999999999863 257
Q ss_pred eeccCCCceEEEeeCCCCccccceEEEcc-EEEeCcccccCCceEEEEecCccCC
Q 041188 140 IESLSPGRCITITSSKSENDTVSKVFIGG-VEITHPDLFNNGIIIIHGIQGYISP 193 (409)
Q Consensus 140 i~Tll~g~~L~Vt~~~~~~~~~~~v~Vng-a~Vt~~Di~~ng~~VIH~ID~VL~P 193 (409)
+.|+..|..+.|+... ..+.++||+ ++|+..|+.. .+|+||+||+||.|
T Consensus 79 ~~t~~~g~~~~v~~~~----~~~~~~v~~~a~i~~~~~~~-~nG~ih~id~vL~P 128 (128)
T PF02469_consen 79 LETLLNGQPLRVSSSP----SNGTIYVNGKARIVKSDIEA-SNGVIHIIDDVLIP 128 (128)
T ss_dssp EEBSSTTCEEEEEEEG----GTTEEEECCEEEESEEEEEE-SSEEEEEESS-TSS
T ss_pred ceeccCCCEEEEEEEe----cCCceEecCceEEEeCCEEe-CCEEEEEECceECc
Confidence 8886689999998762 136899999 9999999863 23599999999998
No 5
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.71 E-value=1.5e-16 Score=170.41 Aligned_cols=247 Identities=19% Similarity=0.222 Sum_probs=164.1
Q ss_pred hhhHHHHHHhcCcHHHHHHhhccCcccccccCCCCeEEEeeCChhhhcCCCC----ChhHHhhhcccCCccchHHHhccc
Q 041188 60 TAMLAPILSHLGFNELATAAPSLSNDAVATSWSGPSTLFAPSDSSLHTCFSC----SVPSLLREHLVPGLFTIDYLRKLA 135 (409)
Q Consensus 60 ~~~l~~~L~~~Gft~la~lL~~~~~~~~~l~~~g~~TIFAPtD~AF~~l~~~----~L~~LL~yHVvpg~~~~~~L~~l~ 135 (409)
..++.++..+...+++.+++...+++ +.+..++.+|+|+|.|+||+++... .+..+|.||++|.+...++..+.
T Consensus 373 ~~~l~~La~e~~~st~~rlv~elgll-~~L~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~~~~~~~y~~- 450 (682)
T KOG1437|consen 373 LKNLMSLAREDEISTSMRLVAELGLL-TALAPNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEYLTSSSMYNG- 450 (682)
T ss_pred HHHHHHHHhcccccHHHHHHHhccce-EEEcCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchhhhhhhhhcc-
Confidence 55677777777788999999999966 4566667799999999999997652 25899999999999999998762
Q ss_pred CCCeeeccCCCceEEEeeCCC-CccccceEEEcc-EEEeCcccc-cCCceEEEEecCccCCCCCCcccccccccccCCCC
Q 041188 136 FGTKIESLSPGRCITITSSKS-ENDTVSKVFIGG-VEITHPDLF-NNGIIIIHGIQGYISPLSPLSCDVERMTSLSFPFQ 212 (409)
Q Consensus 136 ~g~~i~Tll~g~~L~Vt~~~~-~~~~~~~v~Vng-a~Vt~~Di~-~ng~~VIH~ID~VL~P~~~~~~~~~~~~sl~~p~~ 212 (409)
++.++|+ .+..+..-.... ...+...+.++| +.|...|+. .|| +||.||+|+.|-+.
T Consensus 451 -~~~v~t~-g~~~l~~fv~r~~~s~~~t~i~~~~~~~Ii~aDi~~~nG--vvH~id~vl~p~~l---------------- 510 (682)
T KOG1437|consen 451 -QTTVRTL-GKNKLLYFVYRHSVSANVTDILIGNEACIIEADISVKNG--VVHIIDRVLDPVSL---------------- 510 (682)
T ss_pred -cceeecc-CCeEEEEEEecccccccceeeeccceeeEEecccceecC--ceEEeeEEcCcccH----------------
Confidence 3467775 554454433322 112334566666 578888986 677 99999999999221
Q ss_pred CCCCCCcccccccchhHHHHHHHHHHHHHHh-cChhHHHHHHHHh-H-HHHhccCCcEEEecCccccccCC--------c
Q 041188 213 PSDRGHHHQQIQTQQPIMRLMLRDAMLRLRN-NGYSILSLAMKVK-Y-QELINLANMTVFALDDVSIFSGS--------Y 281 (409)
Q Consensus 213 ~~~~~~~~~~~~~~~~i~~~~~~~~~~~L~~-~gfs~~a~lL~~~-l-~~l~~~~~~TVFAPtD~Af~~~~--------~ 281 (409)
++.|+. ..++.+-.+++.. + +++...+++|+|+|||+|+.... .
T Consensus 511 -------------------------~~~l~~d~r~s~~~~~le~~~l~e~l~~~~~~t~fvPt~ka~~~~~~~~~~~~~~ 565 (682)
T KOG1437|consen 511 -------------------------MEDLKTDGRISGTVQGLEGVLLPEELTPEGNYTLFVPTNKAWQKSTKDEKSLFHK 565 (682)
T ss_pred -------------------------HHHHhhccchhhhHHhhhhcCChhhhccCCceEEEeecccccccCCcchhhcchH
Confidence 111111 1233333444432 3 44566688999999999996542 1
Q ss_pred -cccccceeeeecCcc-cChhhhccCCCCcc---cccccCCceEEEEEcCCcccccceEEccEEEecCceeecCCeEEEE
Q 041188 282 -TYISNVRFHIIPNRY-LTIGDLERLPVGTT---LPTLARGQSLTVTTAGGASVTAPLRINYVRVKVPDVMKNLKIVVHG 356 (409)
Q Consensus 282 -~~l~iL~yHVVpg~~-L~~~dL~~l~~g~~---l~TLl~g~~L~vt~~~g~~~~~~l~VN~a~Vv~pDi~~~~~~VVHg 356 (409)
.+.+++.||++++.. ++..+. .... .-++ .+..+.+.....+ ..+|-.+++.+|++..+ +++|.
T Consensus 566 ~~l~~~l~yH~v~~~~~ls~~~~----~~v~~~~k~s~-~~~~~~~~~~~~~-----~~vn~e~~~~~~i~~~n-~~~h~ 634 (682)
T KOG1437|consen 566 KALQDFLKYHLVPGQSRLSLGSS----PYVMIQVKLSL-RGDHLFFSLVNPR-----GDVNKERLVGIDIMGTN-GVVHV 634 (682)
T ss_pred HHHHHHHHhccccceeeeecccc----cceeeeeeEEE-ecccEEeeeeccc-----cceeeeeeeccceeeec-ceeEE
Confidence 122789999999974 332211 1111 2222 3344545543334 67888999999998765 58999
Q ss_pred ec-CcCCCC
Q 041188 357 IY-LPFPHL 364 (409)
Q Consensus 357 Id-~l~p~~ 364 (409)
|| ++-|+.
T Consensus 635 i~~vl~p~~ 643 (682)
T KOG1437|consen 635 IDLVLKPPD 643 (682)
T ss_pred EEEEcccCc
Confidence 99 444653
No 6
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.64 E-value=1.6e-16 Score=131.30 Aligned_cols=86 Identities=36% Similarity=0.500 Sum_probs=70.6
Q ss_pred EEEecCccccccCCc--------c-cc-ccceeeeecCcccChhhhccCCCCcccccccCCceEEEEEcC--Ccccccce
Q 041188 267 TVFALDDVSIFSGSY--------T-YI-SNVRFHIIPNRYLTIGDLERLPVGTTLPTLARGQSLTVTTAG--GASVTAPL 334 (409)
Q Consensus 267 TVFAPtD~Af~~~~~--------~-~l-~iL~yHVVpg~~L~~~dL~~l~~g~~l~TLl~g~~L~vt~~~--g~~~~~~l 334 (409)
|||||+|+||..... + .+ ++|+|||+|++ ++.++|. ++..++|+ .|..|.++..+ +. +
T Consensus 1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~-~~~~~l~---~~~~~~Tl-~g~~l~v~~~~~~~~-----i 70 (99)
T smart00554 1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGR-LSSADLL---NGGTLPTL-AGSKLRVTRSGDSGT-----V 70 (99)
T ss_pred CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCce-EcHHHhc---cCCccccC-CCCEEEEEEeCCCCe-----E
Confidence 899999999976531 1 34 89999999998 5888885 47789998 57889998866 45 9
Q ss_pred EEccEEEecCceeecCCeEEEEec-CcCCC
Q 041188 335 RINYVRVKVPDVMKNLKIVVHGIY-LPFPH 363 (409)
Q Consensus 335 ~VN~a~Vv~pDi~~~~~~VVHgId-~l~p~ 363 (409)
++|+++|+.+|+..++ |+||+|| .++|+
T Consensus 71 ~in~~~v~~~di~~~n-Gvih~Id~vL~P~ 99 (99)
T smart00554 71 TVNGARIVEADIAATN-GVVHVIDRVLLPP 99 (99)
T ss_pred EEcceEEEECCEecCC-eEEEEECceeCCC
Confidence 9999999999998765 7999999 55564
No 7
>PF02469 Fasciclin: Fasciclin domain; InterPro: IPR000782 The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria []. The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein. FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains. Proteins known to contain a FAS1 domain include: Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) []. The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.56 E-value=4.2e-15 Score=127.60 Aligned_cols=107 Identities=31% Similarity=0.358 Sum_probs=79.9
Q ss_pred ChhHHHHHHHH-hH-HHH-hccCCcEEEecCccccccCC----------cccc-ccceeeeecCcccChhhhccCCCC-c
Q 041188 245 GYSILSLAMKV-KY-QEL-INLANMTVFALDDVSIFSGS----------YTYI-SNVRFHIIPNRYLTIGDLERLPVG-T 309 (409)
Q Consensus 245 gfs~~a~lL~~-~l-~~l-~~~~~~TVFAPtD~Af~~~~----------~~~l-~iL~yHVVpg~~L~~~dL~~l~~g-~ 309 (409)
+|+.|..+++. .+ ..+ ...+.+|||||+|+||...+ .+.+ ++|+|||+++. ++.++|. .+ .
T Consensus 2 ~~s~f~~~l~~~~l~~~l~~~~~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~-~~~~~l~---~~~~ 77 (128)
T PF02469_consen 2 DLSTFSRLLEQAGLADLLNDSDGNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGS-ITSSDLR---NGKQ 77 (128)
T ss_dssp TTHHHHHHHHHTTCHHHHGCSSSSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES----HCHHH---CHHE
T ss_pred CHHHHHHHHHHcCCHHHHhcCCCCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCc-eehhhhc---cccc
Confidence 46778888874 34 556 56689999999999996541 2334 89999999998 5888885 45 6
Q ss_pred ccccccCCceEEEEEc--CCcccccceEEcc-EEEecCceeecCCeEEEEecCcC
Q 041188 310 TLPTLARGQSLTVTTA--GGASVTAPLRINY-VRVKVPDVMKNLKIVVHGIYLPF 361 (409)
Q Consensus 310 ~l~TLl~g~~L~vt~~--~g~~~~~~l~VN~-a~Vv~pDi~~~~~~VVHgId~l~ 361 (409)
.++|++.|+.+.|+.. ++. ++||+ ++|+.+|+.+++ |+||.||.+|
T Consensus 78 ~~~t~~~g~~~~v~~~~~~~~-----~~v~~~a~i~~~~~~~~n-G~ih~id~vL 126 (128)
T PF02469_consen 78 TLETLLNGQPLRVSSSPSNGT-----IYVNGKARIVKSDIEASN-GVIHIIDDVL 126 (128)
T ss_dssp EEEBSSTTCEEEEEEEGGTTE-----EEECCEEEESEEEEEESS-EEEEEESS-T
T ss_pred cceeccCCCEEEEEEEecCCc-----eEecCceEEEeCCEEeCC-EEEEEECceE
Confidence 7899558888999876 455 99999 999999997765 7899999554
No 8
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.38 E-value=1.1e-12 Score=141.03 Aligned_cols=226 Identities=19% Similarity=0.157 Sum_probs=143.9
Q ss_pred cCCCCeEEEeeCChhhhcCCCCChhHHhhhcccCCccchHHHhcccCCCeeeccCCCceEEEeeCCC-C-cc-ccceEEE
Q 041188 90 SWSGPSTLFAPSDSSLHTCFSCSVPSLLREHLVPGLFTIDYLRKLAFGTKIESLSPGRCITITSSKS-E-ND-TVSKVFI 166 (409)
Q Consensus 90 ~~~g~~TIFAPtD~AF~~l~~~~L~~LL~yHVvpg~~~~~~L~~l~~g~~i~Tll~g~~L~Vt~~~~-~-~~-~~~~v~V 166 (409)
...++.|++||+|+||.+.+....+.++.||.+.|.+...+..+. ....+...+...+.+.... . .. .+....+
T Consensus 268 ~~~d~rt~~a~tn~a~~~ip~~~~~~~~~~~~v~~~~~~~~i~~~---~~~~~s~~~~~~r~~~~~~~~a~g~~g~~~~~ 344 (682)
T KOG1437|consen 268 PFVDPRTHLAPTNEAFFTIPRGYPPRILGYHLVLGNLKYNHILDN---MKLGPSLAPGTVRLTGEGVAIAPGSSGERYHI 344 (682)
T ss_pred cccccccccccCcchhhcccccCCCcccccccchhhhhhhhhccc---ccccccccccceeeccccccccccCCCceEEe
Confidence 445789999999999999988777888999999988877766542 1111111221122221110 0 00 1246778
Q ss_pred ccEEEeCcccccCCceEEEEecCccCCCCCCcccccccccccCCCCCCCCCCcccccccchhHHHHHHHHHHHHHHhcCh
Q 041188 167 GGVEITHPDLFNNGIIIIHGIQGYISPLSPLSCDVERMTSLSFPFQPSDRGHHHQQIQTQQPIMRLMLRDAMLRLRNNGY 246 (409)
Q Consensus 167 nga~Vt~~Di~~ng~~VIH~ID~VL~P~~~~~~~~~~~~sl~~p~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~L~~~gf 246 (409)
||..++..|...++ ++||.||.+|.|++. ++.++..++..-
T Consensus 345 ng~~~I~kd~i~~~-~~lh~id~~l~p~~~--------------------------------------~~l~~La~e~~~ 385 (682)
T KOG1437|consen 345 NGRAIIQKDFIHTN-GLLHYIDYVLEPDSL--------------------------------------KNLMSLAREDEI 385 (682)
T ss_pred ecceeEEEeeeccc-eEEEEcccccCCchH--------------------------------------HHHHHHHhcccc
Confidence 88666546776542 499999999999631 123444555444
Q ss_pred hHHHHHHHH-hH-HHHhccCCcEEEecCccccccCCc----ccc-ccceeeeecCcccChhhhccCCCCc-ccccccCCc
Q 041188 247 SILSLAMKV-KY-QELINLANMTVFALDDVSIFSGSY----TYI-SNVRFHIIPNRYLTIGDLERLPVGT-TLPTLARGQ 318 (409)
Q Consensus 247 s~~a~lL~~-~l-~~l~~~~~~TVFAPtD~Af~~~~~----~~l-~iL~yHVVpg~~L~~~dL~~l~~g~-~l~TLl~g~ 318 (409)
+++..++.. .+ .-|.....+|+|+|+|+||..+.. ..+ .+|+|||||.+ +..++.. +|. .++|+ ++.
T Consensus 386 st~~rlv~elgll~~L~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~-~~~~~~y---~~~~~v~t~-g~~ 460 (682)
T KOG1437|consen 386 STSMRLVAELGLLTALAPNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEY-LTSSSMY---NGQTTVRTL-GKN 460 (682)
T ss_pred cHHHHHHHhccceEEEcCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchh-hhhhhhh---cccceeecc-CCe
Confidence 555555432 12 224433449999999999987642 223 78999999999 5777775 344 77887 565
Q ss_pred eEEEEE--cCCcccccceEEcc-EEEecCceeecCCeEEEEecCcCCC
Q 041188 319 SLTVTT--AGGASVTAPLRINY-VRVKVPDVMKNLKIVVHGIYLPFPH 363 (409)
Q Consensus 319 ~L~vt~--~~g~~~~~~l~VN~-a~Vv~pDi~~~~~~VVHgId~l~p~ 363 (409)
.+..-. +.+..-...+.+++ +.|...|+...+ |+||.||.++++
T Consensus 461 ~l~~fv~r~~~s~~~t~i~~~~~~~Ii~aDi~~~n-GvvH~id~vl~p 507 (682)
T KOG1437|consen 461 KLLYFVYRHSVSANVTDILIGNEACIIEADISVKN-GVVHIIDRVLDP 507 (682)
T ss_pred EEEEEEecccccccceeeeccceeeEEecccceec-CceEEeeEEcCc
Confidence 444322 22221124456666 688899998766 589999987766
No 9
>PF07172 GRP: Glycine rich protein family; InterPro: IPR010800 This family consists of glycine rich proteins. Some of them may be involved in resistance to environmental stress [].
Probab=36.75 E-value=37 Score=28.47 Aligned_cols=25 Identities=32% Similarity=0.479 Sum_probs=10.0
Q ss_pred cchhhHHHH-HHHHHHHHhhccccccc
Q 041188 5 STSLRFLTI-LAIYLLIITKSAALTDV 30 (409)
Q Consensus 5 ~~~~~~~~~-~~~~~~~~~~~~~~~~~ 30 (409)
|-.+-+|.| ||+++| |++..+-.+.
T Consensus 3 SK~~llL~l~LA~lLl-isSevaa~~~ 28 (95)
T PF07172_consen 3 SKAFLLLGLLLAALLL-ISSEVAAREL 28 (95)
T ss_pred hhHHHHHHHHHHHHHH-HHhhhhhHHh
Confidence 444444433 444444 4433333333
No 10
>PLN03132 NADH dehydrogenase (ubiquinone) flavoprotein 1; Provisional
Probab=17.89 E-value=1.6e+02 Score=31.64 Aligned_cols=19 Identities=5% Similarity=0.039 Sum_probs=14.6
Q ss_pred hHHHHHHhcCcHHHHHHhh
Q 041188 62 MLAPILSHLGFNELATAAP 80 (409)
Q Consensus 62 ~l~~~L~~~Gft~la~lL~ 80 (409)
.+.+.+...||..+-+++.
T Consensus 50 ~l~~y~~~ggy~~l~~~~~ 68 (461)
T PLN03132 50 FLKGAMKRGDWHRTKDLVL 68 (461)
T ss_pred CHHHHHHcCCHHHHHHHHh
Confidence 4888888889987766654
Done!