Query         041188
Match_columns 409
No_of_seqs    232 out of 745
Neff          5.9 
Searched_HMMs 46136
Date          Fri Mar 29 04:38:17 2013
Command       hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/041188.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/041188hhsearch_cdd -cpu 12 -v 0 

 No Hit                             Prob E-value P-value  Score    SS Cols Query HMM  Template HMM
  1 COG2335 Secreted and surface p  99.8 3.9E-20 8.4E-25  169.8   8.1  115   68-195    56-183 (187)
  2 COG2335 Secreted and surface p  99.7 8.4E-18 1.8E-22  154.5  10.3  122  234-366    47-185 (187)
  3 smart00554 FAS1 Four repeated   99.7 7.5E-18 1.6E-22  139.2   6.3   90   96-194     1-99  (99)
  4 PF02469 Fasciclin:  Fasciclin   99.7 7.1E-18 1.5E-22  144.8   5.3  115   71-193     2-128 (128)
  5 KOG1437 Fasciclin and related   99.7 1.5E-16 3.3E-21  170.4  16.5  247   60-364   373-643 (682)
  6 smart00554 FAS1 Four repeated   99.6 1.6E-16 3.4E-21  131.3   5.6   86  267-363     1-99  (99)
  7 PF02469 Fasciclin:  Fasciclin   99.6 4.2E-15 9.1E-20  127.6   6.0  107  245-361     2-126 (128)
  8 KOG1437 Fasciclin and related   99.4 1.1E-12 2.4E-17  141.0  10.1  226   90-363   268-507 (682)
  9 PF07172 GRP:  Glycine rich pro  36.8      37  0.0008   28.5   3.0   25    5-30      3-28  (95)
 10 PLN03132 NADH dehydrogenase (u  17.9 1.6E+02  0.0034   31.6   4.3   19   62-80     50-68  (461)

No 1  
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.81  E-value=3.9e-20  Score=169.80  Aligned_cols=115  Identities=23%  Similarity=0.349  Sum_probs=97.7

Q ss_pred             HhcCcHHHHHHhhccCcccccccCCCCeEEEeeCChhhhcCCC------------CChhHHhhhcccCCccchHHHhccc
Q 041188           68 SHLGFNELATAAPSLSNDAVATSWSGPSTLFAPSDSSLHTCFS------------CSVPSLLREHLVPGLFTIDYLRKLA  135 (409)
Q Consensus        68 ~~~Gft~la~lL~~~~~~~~~l~~~g~~TIFAPtD~AF~~l~~------------~~L~~LL~yHVvpg~~~~~~L~~l~  135 (409)
                      ...-|++|..+++.++ +-+++.+.|+||||||+|+||++++.            ..|.++|.|||++|+++.+++.+. 
T Consensus        56 ~~~~f~tl~~a~~aa~-Lv~~L~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk~~~~~l~~~-  133 (187)
T COG2335          56 NNPSFTTLVAALKAAG-LVDTLNETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGKITAADLKSS-  133 (187)
T ss_pred             cCcchHHHHHHHHhhh-hHHHhcCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCcccHHHhhcc-
Confidence            3344999999999998 44667889999999999999999984            247889999999999999999863 


Q ss_pred             CCCeeeccCCCceEEEeeCCCCccccceEEEccEEEeCcccc-cCCceEEEEecCccCCCC
Q 041188          136 FGTKIESLSPGRCITITSSKSENDTVSKVFIGGVEITHPDLF-NNGIIIIHGIQGYISPLS  195 (409)
Q Consensus       136 ~g~~i~Tll~g~~L~Vt~~~~~~~~~~~v~Vnga~Vt~~Di~-~ng~~VIH~ID~VL~P~~  195 (409)
                        ..+.| +.|..++|...+      ++++||+++|+.+|+. .||  |||+||+||.|+.
T Consensus       134 --~~v~t-~~G~~~~i~~~~------~~~~Vn~a~v~~~di~a~Ng--vIhvID~Vl~Pp~  183 (187)
T COG2335         134 --GSVKT-VQGADLKIKVTG------GGVYVNDATVTIADINASNG--VIHVIDKVLIPPM  183 (187)
T ss_pred             --cccee-ecCceEEEEEcC------CcEEEeeeEEEeccEeccCc--EEEEEeeeccCCC
Confidence              35666 489999998776      4599999999999986 455  9999999999985


No 2  
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.74  E-value=8.4e-18  Score=154.45  Aligned_cols=122  Identities=21%  Similarity=0.352  Sum_probs=98.3

Q ss_pred             HHHHHHHH-HhcChhHHHHHHHHh-H-HHHhccCCcEEEecCccccccCC------------cccc-ccceeeeecCccc
Q 041188          234 LRDAMLRL-RNNGYSILSLAMKVK-Y-QELINLANMTVFALDDVSIFSGS------------YTYI-SNVRFHIIPNRYL  297 (409)
Q Consensus       234 ~~~~~~~L-~~~gfs~~a~lL~~~-l-~~l~~~~~~TVFAPtD~Af~~~~------------~~~l-~iL~yHVVpg~~L  297 (409)
                      .+++++.. ....|+++..+++.. | +.+...++||||||+|+||.++.            .+++ ++|.||||+|+ +
T Consensus        47 ~~~iV~~a~~~~~f~tl~~a~~aa~Lv~~L~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk-~  125 (187)
T COG2335          47 RADIVESAANNPSFTTLVAALKAAGLVDTLNETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGK-I  125 (187)
T ss_pred             hhHHHHHHccCcchHHHHHHHHhhhhHHHhcCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCc-c
Confidence            34567754 556699999998854 5 55788899999999999997652            3455 89999999999 5


Q ss_pred             ChhhhccCCCCcccccccCCceEEEEEcCCcccccceEEccEEEecCceeecCCeEEEEec-CcCCCCCC
Q 041188          298 TIGDLERLPVGTTLPTLARGQSLTVTTAGGASVTAPLRINYVRVKVPDVMKNLKIVVHGIY-LPFPHLHP  366 (409)
Q Consensus       298 ~~~dL~~l~~g~~l~TLl~g~~L~vt~~~g~~~~~~l~VN~a~Vv~pDi~~~~~~VVHgId-~l~p~~~~  366 (409)
                      +.+|+.+   .....|+ +|..+.|...+++     ++||.++|+.+|+..+| ||||.|| +++|+...
T Consensus       126 ~~~~l~~---~~~v~t~-~G~~~~i~~~~~~-----~~Vn~a~v~~~di~a~N-gvIhvID~Vl~Pp~~~  185 (187)
T COG2335         126 TAADLKS---SGSVKTV-QGADLKIKVTGGG-----VYVNDATVTIADINASN-GVIHVIDKVLIPPMDL  185 (187)
T ss_pred             cHHHhhc---cccceee-cCceEEEEEcCCc-----EEEeeeEEEeccEeccC-cEEEEEeeeccCCCcc
Confidence            8888854   4457787 7889999988777     99999999999997765 6999999 88888754


No 3  
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.72  E-value=7.5e-18  Score=139.18  Aligned_cols=90  Identities=27%  Similarity=0.425  Sum_probs=76.2

Q ss_pred             EEEeeCChhhhcCCCC---------ChhHHhhhcccCCccchHHHhcccCCCeeeccCCCceEEEeeCCCCccccceEEE
Q 041188           96 TLFAPSDSSLHTCFSC---------SVPSLLREHLVPGLFTIDYLRKLAFGTKIESLSPGRCITITSSKSENDTVSKVFI  166 (409)
Q Consensus        96 TIFAPtD~AF~~l~~~---------~L~~LL~yHVvpg~~~~~~L~~l~~g~~i~Tll~g~~L~Vt~~~~~~~~~~~v~V  166 (409)
                      |||||+|+||++++..         .++++|+||++|+++..++|.+   +..++|+. |..++++..+.    .+.+++
T Consensus         1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~~~~~~l~~---~~~~~Tl~-g~~l~v~~~~~----~~~i~i   72 (99)
T smart00554        1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGRLSSADLLN---GGTLPTLA-GSKLRVTRSGD----SGTVTV   72 (99)
T ss_pred             CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCceEcHHHhcc---CCccccCC-CCEEEEEEeCC----CCeEEE
Confidence            8999999999987641         5789999999999999999986   56788874 88899987651    268999


Q ss_pred             ccEEEeCcccccCCceEEEEecCccCCC
Q 041188          167 GGVEITHPDLFNNGIIIIHGIQGYISPL  194 (409)
Q Consensus       167 nga~Vt~~Di~~ng~~VIH~ID~VL~P~  194 (409)
                      |+++|+.+|+..+ +|+||+||+||.|+
T Consensus        73 n~~~v~~~di~~~-nGvih~Id~vL~P~   99 (99)
T smart00554       73 NGARIVEADIAAT-NGVVHVIDRVLLPP   99 (99)
T ss_pred             cceEEEECCEecC-CeEEEEECceeCCC
Confidence            9999999999752 35999999999985


No 4  
>PF02469 Fasciclin:  Fasciclin domain;  InterPro: IPR000782  The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria [].  The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein.  FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains.  Proteins known to contain a FAS1 domain include:   Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) [].   The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.71  E-value=7.1e-18  Score=144.84  Aligned_cols=115  Identities=24%  Similarity=0.366  Sum_probs=87.6

Q ss_pred             CcHHHHHHhhccCcccccc-cCCCCeEEEeeCChhhhcCCC----------CChhHHhhhcccCCccchHHHhcccCCCe
Q 041188           71 GFNELATAAPSLSNDAVAT-SWSGPSTLFAPSDSSLHTCFS----------CSVPSLLREHLVPGLFTIDYLRKLAFGTK  139 (409)
Q Consensus        71 Gft~la~lL~~~~~~~~~l-~~~g~~TIFAPtD~AF~~l~~----------~~L~~LL~yHVvpg~~~~~~L~~l~~g~~  139 (409)
                      .|+.|+++|+.+++. +.+ ...+++|||||+|+||++++.          ..+.++|+||++++.+..++|...  ...
T Consensus         2 ~~s~f~~~l~~~~l~-~~l~~~~~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~~~~~~l~~~--~~~   78 (128)
T PF02469_consen    2 DLSTFSRLLEQAGLA-DLLNDSDGNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGSITSSDLRNG--KQT   78 (128)
T ss_dssp             TTHHHHHHHHHTTCH-HHHGCSSSSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES---HCHHHCH--HEE
T ss_pred             CHHHHHHHHHHcCCH-HHHhcCCCCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCceehhhhccc--ccc
Confidence            477888888888744 444 566899999999999987742          247899999999999999999863  257


Q ss_pred             eeccCCCceEEEeeCCCCccccceEEEcc-EEEeCcccccCCceEEEEecCccCC
Q 041188          140 IESLSPGRCITITSSKSENDTVSKVFIGG-VEITHPDLFNNGIIIIHGIQGYISP  193 (409)
Q Consensus       140 i~Tll~g~~L~Vt~~~~~~~~~~~v~Vng-a~Vt~~Di~~ng~~VIH~ID~VL~P  193 (409)
                      +.|+..|..+.|+...    ..+.++||+ ++|+..|+.. .+|+||+||+||.|
T Consensus        79 ~~t~~~g~~~~v~~~~----~~~~~~v~~~a~i~~~~~~~-~nG~ih~id~vL~P  128 (128)
T PF02469_consen   79 LETLLNGQPLRVSSSP----SNGTIYVNGKARIVKSDIEA-SNGVIHIIDDVLIP  128 (128)
T ss_dssp             EEBSSTTCEEEEEEEG----GTTEEEECCEEEESEEEEEE-SSEEEEEESS-TSS
T ss_pred             ceeccCCCEEEEEEEe----cCCceEecCceEEEeCCEEe-CCEEEEEECceECc
Confidence            8886689999998762    136899999 9999999863 23599999999998


No 5  
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.71  E-value=1.5e-16  Score=170.41  Aligned_cols=247  Identities=19%  Similarity=0.222  Sum_probs=164.1

Q ss_pred             hhhHHHHHHhcCcHHHHHHhhccCcccccccCCCCeEEEeeCChhhhcCCCC----ChhHHhhhcccCCccchHHHhccc
Q 041188           60 TAMLAPILSHLGFNELATAAPSLSNDAVATSWSGPSTLFAPSDSSLHTCFSC----SVPSLLREHLVPGLFTIDYLRKLA  135 (409)
Q Consensus        60 ~~~l~~~L~~~Gft~la~lL~~~~~~~~~l~~~g~~TIFAPtD~AF~~l~~~----~L~~LL~yHVvpg~~~~~~L~~l~  135 (409)
                      ..++.++..+...+++.+++...+++ +.+..++.+|+|+|.|+||+++...    .+..+|.||++|.+...++..+. 
T Consensus       373 ~~~l~~La~e~~~st~~rlv~elgll-~~L~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~~~~~~~y~~-  450 (682)
T KOG1437|consen  373 LKNLMSLAREDEISTSMRLVAELGLL-TALAPNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEYLTSSSMYNG-  450 (682)
T ss_pred             HHHHHHHHhcccccHHHHHHHhccce-EEEcCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchhhhhhhhhcc-
Confidence            55677777777788999999999966 4566667799999999999997652    25899999999999999998762 


Q ss_pred             CCCeeeccCCCceEEEeeCCC-CccccceEEEcc-EEEeCcccc-cCCceEEEEecCccCCCCCCcccccccccccCCCC
Q 041188          136 FGTKIESLSPGRCITITSSKS-ENDTVSKVFIGG-VEITHPDLF-NNGIIIIHGIQGYISPLSPLSCDVERMTSLSFPFQ  212 (409)
Q Consensus       136 ~g~~i~Tll~g~~L~Vt~~~~-~~~~~~~v~Vng-a~Vt~~Di~-~ng~~VIH~ID~VL~P~~~~~~~~~~~~sl~~p~~  212 (409)
                       ++.++|+ .+..+..-.... ...+...+.++| +.|...|+. .||  +||.||+|+.|-+.                
T Consensus       451 -~~~v~t~-g~~~l~~fv~r~~~s~~~t~i~~~~~~~Ii~aDi~~~nG--vvH~id~vl~p~~l----------------  510 (682)
T KOG1437|consen  451 -QTTVRTL-GKNKLLYFVYRHSVSANVTDILIGNEACIIEADISVKNG--VVHIIDRVLDPVSL----------------  510 (682)
T ss_pred             -cceeecc-CCeEEEEEEecccccccceeeeccceeeEEecccceecC--ceEEeeEEcCcccH----------------
Confidence             3467775 554454433322 112334566666 578888986 677  99999999999221                


Q ss_pred             CCCCCCcccccccchhHHHHHHHHHHHHHHh-cChhHHHHHHHHh-H-HHHhccCCcEEEecCccccccCC--------c
Q 041188          213 PSDRGHHHQQIQTQQPIMRLMLRDAMLRLRN-NGYSILSLAMKVK-Y-QELINLANMTVFALDDVSIFSGS--------Y  281 (409)
Q Consensus       213 ~~~~~~~~~~~~~~~~i~~~~~~~~~~~L~~-~gfs~~a~lL~~~-l-~~l~~~~~~TVFAPtD~Af~~~~--------~  281 (409)
                                               ++.|+. ..++.+-.+++.. + +++...+++|+|+|||+|+....        .
T Consensus       511 -------------------------~~~l~~d~r~s~~~~~le~~~l~e~l~~~~~~t~fvPt~ka~~~~~~~~~~~~~~  565 (682)
T KOG1437|consen  511 -------------------------MEDLKTDGRISGTVQGLEGVLLPEELTPEGNYTLFVPTNKAWQKSTKDEKSLFHK  565 (682)
T ss_pred             -------------------------HHHHhhccchhhhHHhhhhcCChhhhccCCceEEEeecccccccCCcchhhcchH
Confidence                                     111111 1233333444432 3 44566688999999999996542        1


Q ss_pred             -cccccceeeeecCcc-cChhhhccCCCCcc---cccccCCceEEEEEcCCcccccceEEccEEEecCceeecCCeEEEE
Q 041188          282 -TYISNVRFHIIPNRY-LTIGDLERLPVGTT---LPTLARGQSLTVTTAGGASVTAPLRINYVRVKVPDVMKNLKIVVHG  356 (409)
Q Consensus       282 -~~l~iL~yHVVpg~~-L~~~dL~~l~~g~~---l~TLl~g~~L~vt~~~g~~~~~~l~VN~a~Vv~pDi~~~~~~VVHg  356 (409)
                       .+.+++.||++++.. ++..+.    ....   .-++ .+..+.+.....+     ..+|-.+++.+|++..+ +++|.
T Consensus       566 ~~l~~~l~yH~v~~~~~ls~~~~----~~v~~~~k~s~-~~~~~~~~~~~~~-----~~vn~e~~~~~~i~~~n-~~~h~  634 (682)
T KOG1437|consen  566 KALQDFLKYHLVPGQSRLSLGSS----PYVMIQVKLSL-RGDHLFFSLVNPR-----GDVNKERLVGIDIMGTN-GVVHV  634 (682)
T ss_pred             HHHHHHHHhccccceeeeecccc----cceeeeeeEEE-ecccEEeeeeccc-----cceeeeeeeccceeeec-ceeEE
Confidence             122789999999974 332211    1111   2222 3344545543334     67888999999998765 58999


Q ss_pred             ec-CcCCCC
Q 041188          357 IY-LPFPHL  364 (409)
Q Consensus       357 Id-~l~p~~  364 (409)
                      || ++-|+.
T Consensus       635 i~~vl~p~~  643 (682)
T KOG1437|consen  635 IDLVLKPPD  643 (682)
T ss_pred             EEEEcccCc
Confidence            99 444653


No 6  
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.64  E-value=1.6e-16  Score=131.30  Aligned_cols=86  Identities=36%  Similarity=0.500  Sum_probs=70.6

Q ss_pred             EEEecCccccccCCc--------c-cc-ccceeeeecCcccChhhhccCCCCcccccccCCceEEEEEcC--Ccccccce
Q 041188          267 TVFALDDVSIFSGSY--------T-YI-SNVRFHIIPNRYLTIGDLERLPVGTTLPTLARGQSLTVTTAG--GASVTAPL  334 (409)
Q Consensus       267 TVFAPtD~Af~~~~~--------~-~l-~iL~yHVVpg~~L~~~dL~~l~~g~~l~TLl~g~~L~vt~~~--g~~~~~~l  334 (409)
                      |||||+|+||.....        + .+ ++|+|||+|++ ++.++|.   ++..++|+ .|..|.++..+  +.     +
T Consensus         1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~-~~~~~l~---~~~~~~Tl-~g~~l~v~~~~~~~~-----i   70 (99)
T smart00554        1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGR-LSSADLL---NGGTLPTL-AGSKLRVTRSGDSGT-----V   70 (99)
T ss_pred             CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCce-EcHHHhc---cCCccccC-CCCEEEEEEeCCCCe-----E
Confidence            899999999976531        1 34 89999999998 5888885   47789998 57889998866  45     9


Q ss_pred             EEccEEEecCceeecCCeEEEEec-CcCCC
Q 041188          335 RINYVRVKVPDVMKNLKIVVHGIY-LPFPH  363 (409)
Q Consensus       335 ~VN~a~Vv~pDi~~~~~~VVHgId-~l~p~  363 (409)
                      ++|+++|+.+|+..++ |+||+|| .++|+
T Consensus        71 ~in~~~v~~~di~~~n-Gvih~Id~vL~P~   99 (99)
T smart00554       71 TVNGARIVEADIAATN-GVVHVIDRVLLPP   99 (99)
T ss_pred             EEcceEEEECCEecCC-eEEEEECceeCCC
Confidence            9999999999998765 7999999 55564


No 7  
>PF02469 Fasciclin:  Fasciclin domain;  InterPro: IPR000782  The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria [].  The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein.  FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains.  Proteins known to contain a FAS1 domain include:   Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) [].   The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.56  E-value=4.2e-15  Score=127.60  Aligned_cols=107  Identities=31%  Similarity=0.358  Sum_probs=79.9

Q ss_pred             ChhHHHHHHHH-hH-HHH-hccCCcEEEecCccccccCC----------cccc-ccceeeeecCcccChhhhccCCCC-c
Q 041188          245 GYSILSLAMKV-KY-QEL-INLANMTVFALDDVSIFSGS----------YTYI-SNVRFHIIPNRYLTIGDLERLPVG-T  309 (409)
Q Consensus       245 gfs~~a~lL~~-~l-~~l-~~~~~~TVFAPtD~Af~~~~----------~~~l-~iL~yHVVpg~~L~~~dL~~l~~g-~  309 (409)
                      +|+.|..+++. .+ ..+ ...+.+|||||+|+||...+          .+.+ ++|+|||+++. ++.++|.   .+ .
T Consensus         2 ~~s~f~~~l~~~~l~~~l~~~~~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~-~~~~~l~---~~~~   77 (128)
T PF02469_consen    2 DLSTFSRLLEQAGLADLLNDSDGNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGS-ITSSDLR---NGKQ   77 (128)
T ss_dssp             TTHHHHHHHHHTTCHHHHGCSSSSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES----HCHHH---CHHE
T ss_pred             CHHHHHHHHHHcCCHHHHhcCCCCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCc-eehhhhc---cccc
Confidence            46778888874 34 556 56689999999999996541          2334 89999999998 5888885   45 6


Q ss_pred             ccccccCCceEEEEEc--CCcccccceEEcc-EEEecCceeecCCeEEEEecCcC
Q 041188          310 TLPTLARGQSLTVTTA--GGASVTAPLRINY-VRVKVPDVMKNLKIVVHGIYLPF  361 (409)
Q Consensus       310 ~l~TLl~g~~L~vt~~--~g~~~~~~l~VN~-a~Vv~pDi~~~~~~VVHgId~l~  361 (409)
                      .++|++.|+.+.|+..  ++.     ++||+ ++|+.+|+.+++ |+||.||.+|
T Consensus        78 ~~~t~~~g~~~~v~~~~~~~~-----~~v~~~a~i~~~~~~~~n-G~ih~id~vL  126 (128)
T PF02469_consen   78 TLETLLNGQPLRVSSSPSNGT-----IYVNGKARIVKSDIEASN-GVIHIIDDVL  126 (128)
T ss_dssp             EEEBSSTTCEEEEEEEGGTTE-----EEECCEEEESEEEEEESS-EEEEEESS-T
T ss_pred             cceeccCCCEEEEEEEecCCc-----eEecCceEEEeCCEEeCC-EEEEEECceE
Confidence            7899558888999876  455     99999 999999997765 7899999554


No 8  
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.38  E-value=1.1e-12  Score=141.03  Aligned_cols=226  Identities=19%  Similarity=0.157  Sum_probs=143.9

Q ss_pred             cCCCCeEEEeeCChhhhcCCCCChhHHhhhcccCCccchHHHhcccCCCeeeccCCCceEEEeeCCC-C-cc-ccceEEE
Q 041188           90 SWSGPSTLFAPSDSSLHTCFSCSVPSLLREHLVPGLFTIDYLRKLAFGTKIESLSPGRCITITSSKS-E-ND-TVSKVFI  166 (409)
Q Consensus        90 ~~~g~~TIFAPtD~AF~~l~~~~L~~LL~yHVvpg~~~~~~L~~l~~g~~i~Tll~g~~L~Vt~~~~-~-~~-~~~~v~V  166 (409)
                      ...++.|++||+|+||.+.+....+.++.||.+.|.+...+..+.   ....+...+...+.+.... . .. .+....+
T Consensus       268 ~~~d~rt~~a~tn~a~~~ip~~~~~~~~~~~~v~~~~~~~~i~~~---~~~~~s~~~~~~r~~~~~~~~a~g~~g~~~~~  344 (682)
T KOG1437|consen  268 PFVDPRTHLAPTNEAFFTIPRGYPPRILGYHLVLGNLKYNHILDN---MKLGPSLAPGTVRLTGEGVAIAPGSSGERYHI  344 (682)
T ss_pred             cccccccccccCcchhhcccccCCCcccccccchhhhhhhhhccc---ccccccccccceeeccccccccccCCCceEEe
Confidence            445789999999999999988777888999999988877766542   1111111221122221110 0 00 1246778


Q ss_pred             ccEEEeCcccccCCceEEEEecCccCCCCCCcccccccccccCCCCCCCCCCcccccccchhHHHHHHHHHHHHHHhcCh
Q 041188          167 GGVEITHPDLFNNGIIIIHGIQGYISPLSPLSCDVERMTSLSFPFQPSDRGHHHQQIQTQQPIMRLMLRDAMLRLRNNGY  246 (409)
Q Consensus       167 nga~Vt~~Di~~ng~~VIH~ID~VL~P~~~~~~~~~~~~sl~~p~~~~~~~~~~~~~~~~~~i~~~~~~~~~~~L~~~gf  246 (409)
                      ||..++..|...++ ++||.||.+|.|++.                                      ++.++..++..-
T Consensus       345 ng~~~I~kd~i~~~-~~lh~id~~l~p~~~--------------------------------------~~l~~La~e~~~  385 (682)
T KOG1437|consen  345 NGRAIIQKDFIHTN-GLLHYIDYVLEPDSL--------------------------------------KNLMSLAREDEI  385 (682)
T ss_pred             ecceeEEEeeeccc-eEEEEcccccCCchH--------------------------------------HHHHHHHhcccc
Confidence            88666546776542 499999999999631                                      123444555444


Q ss_pred             hHHHHHHHH-hH-HHHhccCCcEEEecCccccccCCc----ccc-ccceeeeecCcccChhhhccCCCCc-ccccccCCc
Q 041188          247 SILSLAMKV-KY-QELINLANMTVFALDDVSIFSGSY----TYI-SNVRFHIIPNRYLTIGDLERLPVGT-TLPTLARGQ  318 (409)
Q Consensus       247 s~~a~lL~~-~l-~~l~~~~~~TVFAPtD~Af~~~~~----~~l-~iL~yHVVpg~~L~~~dL~~l~~g~-~l~TLl~g~  318 (409)
                      +++..++.. .+ .-|.....+|+|+|+|+||..+..    ..+ .+|+|||||.+ +..++..   +|. .++|+ ++.
T Consensus       386 st~~rlv~elgll~~L~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~-~~~~~~y---~~~~~v~t~-g~~  460 (682)
T KOG1437|consen  386 STSMRLVAELGLLTALAPNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEY-LTSSSMY---NGQTTVRTL-GKN  460 (682)
T ss_pred             cHHHHHHHhccceEEEcCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchh-hhhhhhh---cccceeecc-CCe
Confidence            555555432 12 224433449999999999987642    223 78999999999 5777775   344 77887 565


Q ss_pred             eEEEEE--cCCcccccceEEcc-EEEecCceeecCCeEEEEecCcCCC
Q 041188          319 SLTVTT--AGGASVTAPLRINY-VRVKVPDVMKNLKIVVHGIYLPFPH  363 (409)
Q Consensus       319 ~L~vt~--~~g~~~~~~l~VN~-a~Vv~pDi~~~~~~VVHgId~l~p~  363 (409)
                      .+..-.  +.+..-...+.+++ +.|...|+...+ |+||.||.++++
T Consensus       461 ~l~~fv~r~~~s~~~t~i~~~~~~~Ii~aDi~~~n-GvvH~id~vl~p  507 (682)
T KOG1437|consen  461 KLLYFVYRHSVSANVTDILIGNEACIIEADISVKN-GVVHIIDRVLDP  507 (682)
T ss_pred             EEEEEEecccccccceeeeccceeeEEecccceec-CceEEeeEEcCc
Confidence            444322  22221124456666 688899998766 589999987766


No 9  
>PF07172 GRP:  Glycine rich protein family;  InterPro: IPR010800 This family consists of glycine rich proteins. Some of them may be involved in resistance to environmental stress [].
Probab=36.75  E-value=37  Score=28.47  Aligned_cols=25  Identities=32%  Similarity=0.479  Sum_probs=10.0

Q ss_pred             cchhhHHHH-HHHHHHHHhhccccccc
Q 041188            5 STSLRFLTI-LAIYLLIITKSAALTDV   30 (409)
Q Consensus         5 ~~~~~~~~~-~~~~~~~~~~~~~~~~~   30 (409)
                      |-.+-+|.| ||+++| |++..+-.+.
T Consensus         3 SK~~llL~l~LA~lLl-isSevaa~~~   28 (95)
T PF07172_consen    3 SKAFLLLGLLLAALLL-ISSEVAAREL   28 (95)
T ss_pred             hhHHHHHHHHHHHHHH-HHhhhhhHHh
Confidence            444444433 444444 4433333333


No 10 
>PLN03132 NADH dehydrogenase (ubiquinone) flavoprotein 1; Provisional
Probab=17.89  E-value=1.6e+02  Score=31.64  Aligned_cols=19  Identities=5%  Similarity=0.039  Sum_probs=14.6

Q ss_pred             hHHHHHHhcCcHHHHHHhh
Q 041188           62 MLAPILSHLGFNELATAAP   80 (409)
Q Consensus        62 ~l~~~L~~~Gft~la~lL~   80 (409)
                      .+.+.+...||..+-+++.
T Consensus        50 ~l~~y~~~ggy~~l~~~~~   68 (461)
T PLN03132         50 FLKGAMKRGDWHRTKDLVL   68 (461)
T ss_pred             CHHHHHHcCCHHHHHHHHh
Confidence            4888888889987766654


Done!