Query 019462
Match_columns 340
No_of_seqs 213 out of 1185
Neff 6.9
Searched_HMMs 46136
Date Fri Mar 29 09:39:56 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/019462.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/019462hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 COG2335 Secreted and surface p 99.9 2.3E-22 5.1E-27 176.3 3.8 124 187-316 48-184 (187)
2 smart00554 FAS1 Four repeated 99.8 6E-20 1.3E-24 146.8 4.4 90 219-314 1-99 (99)
3 PF02469 Fasciclin: Fasciclin 99.7 1.6E-18 3.5E-23 144.3 4.4 112 197-313 2-128 (128)
4 KOG1437 Fasciclin and related 99.7 6.7E-18 1.5E-22 173.7 9.1 219 54-315 402-643 (682)
5 COG2335 Secreted and surface p 99.7 6.6E-17 1.4E-21 142.1 5.3 92 54-154 77-182 (187)
6 smart00554 FAS1 Four repeated 99.6 5.6E-17 1.2E-21 129.5 3.3 88 60-154 1-99 (99)
7 KOG1437 Fasciclin and related 99.5 6.3E-14 1.4E-18 144.6 10.7 220 57-313 271-507 (682)
8 PF02469 Fasciclin: Fasciclin 99.5 6.4E-15 1.4E-19 122.6 -0.1 92 57-153 24-128 (128)
9 PF07172 GRP: Glycine rich pro 55.2 8.8 0.00019 30.6 2.0 22 1-22 1-24 (95)
10 PF10731 Anophelin: Thrombin i 34.8 35 0.00075 24.9 2.2 22 1-22 1-23 (65)
No 1
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.85 E-value=2.3e-22 Score=176.34 Aligned_cols=124 Identities=22% Similarity=0.357 Sum_probs=101.2
Q ss_pred ccchhccc-ccCchhhhHHHhhH-hhh-hccceeEEEeeecccccccccc----------cchhHHHHhhhhhHhhhhcc
Q 019462 187 GEASDLLN-SRGYTLMATFLDMQ-LAR-FTNQTRLTIFAPVDAAMEPYVK----------NITDCVSIFKQHVVLRLLRW 253 (340)
Q Consensus 187 ~~~~~~L~-~~g~~~~~~~L~~~-l~~-l~~~~~~TvFAPtD~Af~~~~~----------~~~~l~~iL~yHvVp~~~~~ 253 (340)
.++++... ...|+++..++++. |-+ +.+.++||||||+|+||.+++. +...|.++|.||||+|+++.
T Consensus 48 ~~iV~~a~~~~~f~tl~~a~~aa~Lv~~L~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk~~~ 127 (187)
T COG2335 48 ADIVESAANNPSFTTLVAALKAAGLVDTLNETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGKITA 127 (187)
T ss_pred hHHHHHHccCcchHHHHHHHHhhhhHHHhcCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCcccH
Confidence 35555554 44599999988653 544 5667899999999999999875 33457889999999999999
Q ss_pred cceeeccCCccccCCCCCeEEEEEEeccEEEECCceeecccccccceEEeeecccccccCCCc
Q 019462 254 QDLIRLDGGTTLPTSSEGFKITVAYSGDVILLNGVPVVFPDMYSSNWLVVHGLDSLLAVSPLD 316 (340)
Q Consensus 254 ~dL~~~~~g~~l~Tl~~g~~L~v~~~~~~i~vn~a~V~~~di~~~~~gvIH~Id~VL~~p~~~ 316 (340)
+++.. .....|+ +|..++|...+++++||+++|+.+|+.. +|||||+||+|| +||..
T Consensus 128 ~~l~~---~~~v~t~-~G~~~~i~~~~~~~~Vn~a~v~~~di~a-~NgvIhvID~Vl-~Pp~~ 184 (187)
T COG2335 128 ADLKS---SGSVKTV-QGADLKIKVTGGGVYVNDATVTIADINA-SNGVIHVIDKVL-IPPMD 184 (187)
T ss_pred HHhhc---cccceee-cCceEEEEEcCCcEEEeeeEEEeccEec-cCcEEEEEeeec-cCCCc
Confidence 99864 3346777 6899999999889999999999999764 779999999999 99864
No 2
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.79 E-value=6e-20 Score=146.79 Aligned_cols=90 Identities=36% Similarity=0.522 Sum_probs=77.9
Q ss_pred EEeeeccccccccccc----c--h-hHHHHhhhhhHhhhhcccceeeccCCccccCCCCCeEEEEEEec--cEEEECCce
Q 019462 219 TIFAPVDAAMEPYVKN----I--T-DCVSIFKQHVVLRLLRWQDLIRLDGGTTLPTSSEGFKITVAYSG--DVILLNGVP 289 (340)
Q Consensus 219 TvFAPtD~Af~~~~~~----~--~-~l~~iL~yHvVp~~~~~~dL~~~~~g~~l~Tl~~g~~L~v~~~~--~~i~vn~a~ 289 (340)
|+|||+|+||+++... . + .++++|+||++|++++.++|.. +..++|+. |..++++..+ +.+++|+++
T Consensus 1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~~~~~~l~~---~~~~~Tl~-g~~l~v~~~~~~~~i~in~~~ 76 (99)
T smart00554 1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGRLSSADLLN---GGTLPTLA-GSKLRVTRSGDSGTVTVNGAR 76 (99)
T ss_pred CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCceEcHHHhcc---CCccccCC-CCEEEEEEeCCCCeEEEcceE
Confidence 8999999999997542 1 1 5789999999999999988864 66789985 8899999987 799999999
Q ss_pred eecccccccceEEeeecccccccCC
Q 019462 290 VVFPDMYSSNWLVVHGLDSLLAVSP 314 (340)
Q Consensus 290 V~~~di~~~~~gvIH~Id~VL~~p~ 314 (340)
|+.+|+.+ +||+||+||+|| +|+
T Consensus 77 v~~~di~~-~nGvih~Id~vL-~P~ 99 (99)
T smart00554 77 IVEADIAA-TNGVVHVIDRVL-LPP 99 (99)
T ss_pred EEECCEec-CCeEEEEECcee-CCC
Confidence 99999876 569999999999 886
No 3
>PF02469 Fasciclin: Fasciclin domain; InterPro: IPR000782 The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria []. The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein. FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains. Proteins known to contain a FAS1 domain include: Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) []. The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.73 E-value=1.6e-18 Score=144.30 Aligned_cols=112 Identities=28% Similarity=0.404 Sum_probs=83.7
Q ss_pred CchhhhHHHhh-Hhhh-h-ccceeEEEeeecccccccccc--------cchhHHHHhhhhhHhhhhcccceeeccCC-cc
Q 019462 197 GYTLMATFLDM-QLAR-F-TNQTRLTIFAPVDAAMEPYVK--------NITDCVSIFKQHVVLRLLRWQDLIRLDGG-TT 264 (340)
Q Consensus 197 g~~~~~~~L~~-~l~~-l-~~~~~~TvFAPtD~Af~~~~~--------~~~~l~~iL~yHvVp~~~~~~dL~~~~~g-~~ 264 (340)
+|+.|..+++. .+.+ + ...+.+|||||+|+||+++.. ..+.++++|+||++++.+..++|.. + ..
T Consensus 2 ~~s~f~~~l~~~~l~~~l~~~~~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~~~~~~l~~---~~~~ 78 (128)
T PF02469_consen 2 DLSTFSRLLEQAGLADLLNDSDGNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGSITSSDLRN---GKQT 78 (128)
T ss_dssp TTHHHHHHHHHTTCHHHHGCSSSSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES---HCHHHC---HHEE
T ss_pred CHHHHHHHHHHcCCHHHHhcCCCCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCceehhhhcc---cccc
Confidence 45666766643 3333 4 345789999999999988732 2345789999999999998888753 4 56
Q ss_pred ccCCCCCeEEEEEEe--ccEEEECC-ceeecccccccceEEeeecccccccC
Q 019462 265 LPTSSEGFKITVAYS--GDVILLNG-VPVVFPDMYSSNWLVVHGLDSLLAVS 313 (340)
Q Consensus 265 l~Tl~~g~~L~v~~~--~~~i~vn~-a~V~~~di~~~~~gvIH~Id~VL~~p 313 (340)
++|...|..+.|+.. ++.+.||+ ++|+.+|+.+ +||+||+||+|| +|
T Consensus 79 ~~t~~~g~~~~v~~~~~~~~~~v~~~a~i~~~~~~~-~nG~ih~id~vL-~P 128 (128)
T PF02469_consen 79 LETLLNGQPLRVSSSPSNGTIYVNGKARIVKSDIEA-SNGVIHIIDDVL-IP 128 (128)
T ss_dssp EEBSSTTCEEEEEEEGGTTEEEECCEEEESEEEEEE-SSEEEEEESS-T-SS
T ss_pred ceeccCCCEEEEEEEecCCceEecCceEEEeCCEEe-CCEEEEEECceE-Cc
Confidence 888557899999988 67999999 9999999865 679999999999 87
No 4
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.73 E-value=6.7e-18 Score=173.67 Aligned_cols=219 Identities=21% Similarity=0.179 Sum_probs=140.7
Q ss_pred ccceeEEeecCCCcccccccc-cc----ccceeeecCCCccCccccchhhccC-CccccccCceEEEEEcc----CCcce
Q 019462 54 LESKTLTIFSPSDFSFSQSGQ-LS----LSQLQYHISPSRLSQDSLKTLAFGS-RLPTLLSNHSLIVTVSD----FNNAH 123 (340)
Q Consensus 54 l~~~~~TVFAPtd~AF~~~~~-~~----l~lL~yHvvp~~~~~~~L~~l~~g~-~l~Tl~~g~~l~vt~~~----~~~~~ 123 (340)
.+.+..|+|+|+|+||.+... .. ..+|+||+++.+...++..+ |+ .++|+ .|..+..-... .+...
T Consensus 402 ~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~~~~~~~y~---~~~~v~t~-g~~~l~~fv~r~~~s~~~t~ 477 (682)
T KOG1437|consen 402 APNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEYLTSSSMYN---GQTTVRTL-GKNKLLYFVYRHSVSANVTD 477 (682)
T ss_pred cCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchhhhhhhhhc---ccceeecc-CCeEEEEEEeccccccccee
Confidence 344459999999999998532 11 28999999999999998875 44 56666 45555544443 11123
Q ss_pred eeeee-eEeecCCCC-CccceEEeeehhhccccceeeecCCCCCCCCCCCCCCCCccccccccccccchhccccc-Cchh
Q 019462 124 LSING-VLIQESPMF-DQEELVVYGIDEFFNSSFGVMISPPPHSAPVPSPVPSPIEPIGFDVDVFGEASDLLNSR-GYTL 200 (340)
Q Consensus 124 v~vn~-a~I~~~di~-~ng~~vVH~Id~VL~P~~~~~~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~L~~~-g~~~ 200 (340)
+.++| ++|+..|+. .|| +||.||+|+.|. ...+ .|++. .++.
T Consensus 478 i~~~~~~~Ii~aDi~~~nG--vvH~id~vl~p~-~l~~--------------------------------~l~~d~r~s~ 522 (682)
T KOG1437|consen 478 ILIGNEACIIEADISVKNG--VVHIIDRVLDPV-SLME--------------------------------DLKTDGRISG 522 (682)
T ss_pred eeccceeeEEecccceecC--ceEEeeEEcCcc-cHHH--------------------------------HHhhccchhh
Confidence 55554 678899985 778 999999999992 2111 12211 1333
Q ss_pred hhHHHhhH-h-hhhccceeEEEeeecccccccccccc------hhHHHHhhhhhHhhhhc--ccceeeccCCccccCCCC
Q 019462 201 MATFLDMQ-L-ARFTNQTRLTIFAPVDAAMEPYVKNI------TDCVSIFKQHVVLRLLR--WQDLIRLDGGTTLPTSSE 270 (340)
Q Consensus 201 ~~~~L~~~-l-~~l~~~~~~TvFAPtD~Af~~~~~~~------~~l~~iL~yHvVp~~~~--~~dL~~~~~g~~l~Tl~~ 270 (340)
+..+++.. + .++...+.||+|+|||+||++...+. ..+.++++||++++... ..+......+ ..-+. .
T Consensus 523 ~~~~le~~~l~e~l~~~~~~t~fvPt~ka~~~~~~~~~~~~~~~~l~~~l~yH~v~~~~~ls~~~~~~v~~~-~k~s~-~ 600 (682)
T KOG1437|consen 523 TVQGLEGVLLPEELTPEGNYTLFVPTNKAWQKSTKDEKSLFHKKALQDFLKYHLVPGQSRLSLGSSPYVMIQ-VKLSL-R 600 (682)
T ss_pred hHHhhhhcCChhhhccCCceEEEeecccccccCCcchhhcchHHHHHHHHHhccccceeeeecccccceeee-eeEEE-e
Confidence 34444332 2 33445678999999999999865432 45789999999997653 1111000000 11111 2
Q ss_pred CeEEEEEEeccEEEECCceeecccccccceEEeeecccccccCCC
Q 019462 271 GFKITVAYSGDVILLNGVPVVFPDMYSSNWLVVHGLDSLLAVSPL 315 (340)
Q Consensus 271 g~~L~v~~~~~~i~vn~a~V~~~di~~~~~gvIH~Id~VL~~p~~ 315 (340)
|.++-+....+...+|-.+++..|++. .||++|.||.|| .|++
T Consensus 601 ~~~~~~~~~~~~~~vn~e~~~~~~i~~-~n~~~h~i~~vl-~p~~ 643 (682)
T KOG1437|consen 601 GDHLFFSLVNPRGDVNKERLVGIDIMG-TNGVVHVIDLVL-KPPD 643 (682)
T ss_pred cccEEeeeeccccceeeeeeeccceee-ecceeEEEEEEc-ccCc
Confidence 344444444456666778899999864 678999999999 7763
No 5
>COG2335 Secreted and surface protein containing fasciclin-like repeats [Cell envelope biogenesis, outer membrane]
Probab=99.66 E-value=6.6e-17 Score=142.07 Aligned_cols=92 Identities=20% Similarity=0.362 Sum_probs=77.9
Q ss_pred ccceeEEeecCCCcccccccc--------cc----c-cceeeecCCCccCccccchhhccCCccccccCceEEEEEccCC
Q 019462 54 LESKTLTIFSPSDFSFSQSGQ--------LS----L-SQLQYHISPSRLSQDSLKTLAFGSRLPTLLSNHSLIVTVSDFN 120 (340)
Q Consensus 54 l~~~~~TVFAPtd~AF~~~~~--------~~----l-~lL~yHvvp~~~~~~~L~~l~~g~~l~Tl~~g~~l~vt~~~~~ 120 (340)
.+.|+||||||+|+||.+++. |. + ++|.||+++|+++.+++.. ...+.|+ +|..++|...+
T Consensus 77 ~~~gp~TVFaPtn~AFa~lp~~T~~~Ll~pen~~~L~~iLtYHVv~Gk~~~~~l~~---~~~v~t~-~G~~~~i~~~~-- 150 (187)
T COG2335 77 NETGPFTVFAPTNEAFAKLPAGTLDALLKPENKPLLTKILTYHVVEGKITAADLKS---SGSVKTV-QGADLKIKVTG-- 150 (187)
T ss_pred cCCCCeEEecCCHHHHHhCChhHHHHHhCccchhhhheeeEEEEEcCcccHHHhhc---cccceee-cCceEEEEEcC--
Confidence 346899999999999999863 11 1 8999999999999999985 3346665 89999999876
Q ss_pred cceeeeeeeEeecCCCC-CccceEEeeehhhcccc
Q 019462 121 NAHLSINGVLIQESPMF-DQEELVVYGIDEFFNSS 154 (340)
Q Consensus 121 ~~~v~vn~a~I~~~di~-~ng~~vVH~Id~VL~P~ 154 (340)
++++||+++++..|+. +|| +||.||+||.||
T Consensus 151 -~~~~Vn~a~v~~~di~a~Ng--vIhvID~Vl~Pp 182 (187)
T COG2335 151 -GGVYVNDATVTIADINASNG--VIHVIDKVLIPP 182 (187)
T ss_pred -CcEEEeeeEEEeccEeccCc--EEEEEeeeccCC
Confidence 4599999999999985 777 999999999998
No 6
>smart00554 FAS1 Four repeated domains in the Fasciclin I family of proteins, present in many other contexts.
Probab=99.65 E-value=5.6e-17 Score=129.53 Aligned_cols=88 Identities=35% Similarity=0.522 Sum_probs=73.9
Q ss_pred EeecCCCccccccccc---------cc-cceeeecCCCccCccccchhhccCCccccccCceEEEEEccCCcceeeeeee
Q 019462 60 TIFSPSDFSFSQSGQL---------SL-SQLQYHISPSRLSQDSLKTLAFGSRLPTLLSNHSLIVTVSDFNNAHLSINGV 129 (340)
Q Consensus 60 TVFAPtd~AF~~~~~~---------~l-~lL~yHvvp~~~~~~~L~~l~~g~~l~Tl~~g~~l~vt~~~~~~~~v~vn~a 129 (340)
|||||+|+||++++.. .+ ++|+||+++++++.++|.. +..++|+ .|..++++..+ ..+.+++|++
T Consensus 1 TvfaP~d~Af~~~~~~~~~~l~~~~~l~~ll~~Hiv~~~~~~~~l~~---~~~~~Tl-~g~~l~v~~~~-~~~~i~in~~ 75 (99)
T smart00554 1 TVFAPTDEAFQKLPPGTLNSLLADPKLKNLLLYHVVPGRLSSADLLN---GGTLPTL-AGSKLRVTRSG-DSGTVTVNGA 75 (99)
T ss_pred CEeCcCHHHHHhcCHHHHHHHhCCHHHHHHHHhcEeCceEcHHHhcc---CCccccC-CCCEEEEEEeC-CCCeEEEcce
Confidence 8999999999987531 22 8999999999999999875 6678887 58999999875 1268999999
Q ss_pred EeecCCCC-CccceEEeeehhhcccc
Q 019462 130 LIQESPMF-DQEELVVYGIDEFFNSS 154 (340)
Q Consensus 130 ~I~~~di~-~ng~~vVH~Id~VL~P~ 154 (340)
+|+.+|+. .|| +||+||+||.|+
T Consensus 76 ~v~~~di~~~nG--vih~Id~vL~P~ 99 (99)
T smart00554 76 RIVEADIAATNG--VVHVIDRVLLPP 99 (99)
T ss_pred EEEECCEecCCe--EEEEECceeCCC
Confidence 99999996 555 999999999985
No 7
>KOG1437 consensus Fasciclin and related adhesion glycoproteins [Cell wall/membrane/envelope biogenesis; Extracellular structures]
Probab=99.51 E-value=6.3e-14 Score=144.59 Aligned_cols=220 Identities=16% Similarity=0.184 Sum_probs=135.6
Q ss_pred eeEEeecCCCccccccccccc-cceeeecCCCccCccccch-hhccCCccc---cccCceEEEEEccCCcceeeeeeeEe
Q 019462 57 KTLTIFSPSDFSFSQSGQLSL-SQLQYHISPSRLSQDSLKT-LAFGSRLPT---LLSNHSLIVTVSDFNNAHLSINGVLI 131 (340)
Q Consensus 57 ~~~TVFAPtd~AF~~~~~~~l-~lL~yHvvp~~~~~~~L~~-l~~g~~l~T---l~~g~~l~vt~~~~~~~~v~vn~a~I 131 (340)
++.|.+||+|.||.+.+.... .++.||.+.|.+......+ +.-|..++- -..|+...+..+. .+....+||..+
T Consensus 271 d~rt~~a~tn~a~~~ip~~~~~~~~~~~~v~~~~~~~~i~~~~~~~~s~~~~~~r~~~~~~~~a~g~-~g~~~~~ng~~~ 349 (682)
T KOG1437|consen 271 DPRTHLAPTNEAFFTIPRGYPPRILGYHLVLGNLKYNHILDNMKLGPSLAPGTVRLTGEGVAIAPGS-SGERYHINGRAI 349 (682)
T ss_pred ccccccccCcchhhcccccCCCcccccccchhhhhhhhhcccccccccccccceeeccccccccccC-CCceEEeeccee
Confidence 579999999999987654332 5677888887765444332 111111110 0112222222222 234677888766
Q ss_pred ecCCCCCccceEEeeehhhccccceeeecCCCCCCCCCCCCCCCCccccccccccccchhcccccCchhhhHHHhh-Hh-
Q 019462 132 QESPMFDQEELVVYGIDEFFNSSFGVMISPPPHSAPVPSPVPSPIEPIGFDVDVFGEASDLLNSRGYTLMATFLDM-QL- 209 (340)
Q Consensus 132 ~~~di~~ng~~vVH~Id~VL~P~~~~~~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~L~~~g~~~~~~~L~~-~l- 209 (340)
+..|...++ +++|.||.++.|+... +.+++.+....+++...+.. .+
T Consensus 350 I~kd~i~~~-~~lh~id~~l~p~~~~------------------------------~l~~La~e~~~st~~rlv~elgll 398 (682)
T KOG1437|consen 350 IQKDFIHTN-GLLHYIDYVLEPDSLK------------------------------NLMSLAREDEISTSMRLVAELGLL 398 (682)
T ss_pred EEEeeeccc-eEEEEcccccCCchHH------------------------------HHHHHHhcccccHHHHHHHhccce
Confidence 657776442 3899999999997321 23334444344444444422 22
Q ss_pred hhhccceeEEEeeecccccccccccc--hhHHHHhhhhhHhhhhcccceeeccCCccccCCCCCeEEEEEEecc------
Q 019462 210 ARFTNQTRLTIFAPVDAAMEPYVKNI--TDCVSIFKQHVVLRLLRWQDLIRLDGGTTLPTSSEGFKITVAYSGD------ 281 (340)
Q Consensus 210 ~~l~~~~~~TvFAPtD~Af~~~~~~~--~~l~~iL~yHvVp~~~~~~dL~~~~~g~~l~Tl~~g~~L~v~~~~~------ 281 (340)
.-+...+.+|+|+|+|+||+...... ...+.||+||++|.++..++..+ .++.++|+ +|..+..-...+
T Consensus 399 ~~L~~n~e~t~~lp~n~~fd~~~~~~~r~l~~qIL~~HII~~~~~~~~~y~--~~~~v~t~-g~~~l~~fv~r~~~s~~~ 475 (682)
T KOG1437|consen 399 TALAPNDEATLLLPTNNLFDDLTPLESRRLAEQILYNHIIPEYLTSSSMYN--GQTTVRTL-GKNKLLYFVYRHSVSANV 475 (682)
T ss_pred EEEcCCCceEEeeehhhhccCCChhhhHHHHHHHHHHhCcchhhhhhhhhc--ccceeecc-CCeEEEEEEecccccccc
Confidence 22444445999999999999865421 22578999999999988877653 23378887 455554433321
Q ss_pred -EEEECC-ceeecccccccceEEeeecccccccC
Q 019462 282 -VILLNG-VPVVFPDMYSSNWLVVHGLDSLLAVS 313 (340)
Q Consensus 282 -~i~vn~-a~V~~~di~~~~~gvIH~Id~VL~~p 313 (340)
.+.++| +.|...|+.. ++|+||.||+|| .|
T Consensus 476 t~i~~~~~~~Ii~aDi~~-~nGvvH~id~vl-~p 507 (682)
T KOG1437|consen 476 TDILIGNEACIIEADISV-KNGVVHIIDRVL-DP 507 (682)
T ss_pred eeeeccceeeEEecccce-ecCceEEeeEEc-Cc
Confidence 455655 5688999865 679999999999 76
No 8
>PF02469 Fasciclin: Fasciclin domain; InterPro: IPR000782 The FAS1 (fasciclin-like) domain is an extracellular module of about 140 amino acid residues. It has been suggested that the FAS1 domain represents an ancient cell adhesion domain common to plants and animals []; related FAS1 domains are also found in bacteria []. The crystal structure of FAS1 domains 3 and 4 of fasciclin I from Drosophila melanogaster (Fruit fly) has been determined, revealing a novel domain fold consisting of a seven-stranded beta wedge and at least five alpha helices; two well-ordered N-acetylglucosamine groups attached to a conserved asparagine are located in the interface region between the two FAS1 domains []. Fasciclin I is an insect neural cell adhesion molecule involved in axonal guidance that is attached to the membrane by a GPI-anchored protein. FAS1 domains are present in many secreted and membrane-anchored proteins. These proteins are usually GPI anchored and consist of: (i) a single FAS1 domain, (ii) a tandem array of FAS1 domains, or (iii) FAS1 domain(s) interspersed with other domains. Proteins known to contain a FAS1 domain include: Fasciclin I (4 FAS1 domains). Human TGF-beta induced Ig-H3 (BIgH3) protein (4 FAS1 domains), where the FAS1 domains mediate cell adhesion through an interaction with alpha3/beta1 integrin; mutation in the FAS1 domains result in corneal dystrophy []. Volvox major cell adhesion protein (2 FAS1 domains) []. Arabidopsis fasciclin-like arabinogalactan proteins (2 FAS1 domains) []. Mammalian stabilin protein, a family of fasciclin-like hyaluronan receptor homologues (7 FAS1 domains)[]. Human extracellular matrix protein periostin (4 FAS1 domains). Bacterial immunogenic protein MPT70 (1 FAS1 domain) []. The FAS1 domains of both human periostin (Q15063 from SWISSPROT) and BIgH3 (Q15582 from SWISSPROT) proteins were found to contain vitamin K-dependent gamma-carboxyglutamate residues []. Gamma-carboxyglutamate residues are more commonly associated with GLA domains (IPR000294 from INTERPRO), where they occur through post-translational modification catalysed by the vitamin K-dependent enzyme gamma-glutamylcarboxylase.; PDB: 1O70_A 1W7D_A 1W7E_A 1NYO_A 1X3B_A 2VXP_A.
Probab=99.47 E-value=6.4e-15 Score=122.56 Aligned_cols=92 Identities=32% Similarity=0.467 Sum_probs=70.6
Q ss_pred eeEEeecCCCccccccccc----------cc-cceeeecCCCccCccccchhhccCCccccccCceEEEEEccCCcceee
Q 019462 57 KTLTIFSPSDFSFSQSGQL----------SL-SQLQYHISPSRLSQDSLKTLAFGSRLPTLLSNHSLIVTVSDFNNAHLS 125 (340)
Q Consensus 57 ~~~TVFAPtd~AF~~~~~~----------~l-~lL~yHvvp~~~~~~~L~~l~~g~~l~Tl~~g~~l~vt~~~~~~~~v~ 125 (340)
+.+|||||+|+||.+++.. .+ ++|+||++++.++.++++.. ...+.|.+.|..+.|+... .++.++
T Consensus 24 ~~~TvfaP~d~a~~~~~~~~~~~~~~~~~~l~~~l~~hiv~~~~~~~~l~~~--~~~~~t~~~g~~~~v~~~~-~~~~~~ 100 (128)
T PF02469_consen 24 GNYTVFAPTDDAFQKLSQETNSSLADSKEQLKSLLKYHIVPGSITSSDLRNG--KQTLETLLNGQPLRVSSSP-SNGTIY 100 (128)
T ss_dssp SSEEEEEE-HHHHHHSHHHHHHHHHTHHHHHHHHHHHTEEES---HCHHHCH--HEEEEBSSTTCEEEEEEEG-GTTEEE
T ss_pred CCEEEEEECHHHHHhccccccchhhhhhhhHhhhhhhEEEcCceehhhhccc--cccceeccCCCEEEEEEEe-cCCceE
Confidence 5899999999999876411 12 89999999999999998752 1568886689999999872 257899
Q ss_pred eee-eEeecCCCC-CccceEEeeehhhccc
Q 019462 126 ING-VLIQESPMF-DQEELVVYGIDEFFNS 153 (340)
Q Consensus 126 vn~-a~I~~~di~-~ng~~vVH~Id~VL~P 153 (340)
+|+ ++|+..|+. .|| +||+||+||.|
T Consensus 101 v~~~a~i~~~~~~~~nG--~ih~id~vL~P 128 (128)
T PF02469_consen 101 VNGKARIVKSDIEASNG--VIHIIDDVLIP 128 (128)
T ss_dssp ECCEEEESEEEEEESSE--EEEEESS-TSS
T ss_pred ecCceEEEeCCEEeCCE--EEEEECceECc
Confidence 999 999988985 666 99999999988
No 9
>PF07172 GRP: Glycine rich protein family; InterPro: IPR010800 This family consists of glycine rich proteins. Some of them may be involved in resistance to environmental stress [].
Probab=55.23 E-value=8.8 Score=30.61 Aligned_cols=22 Identities=27% Similarity=0.313 Sum_probs=11.0
Q ss_pred CcchhhHHHHHHH--HHhhhhhcC
Q 019462 1 MATLIIFSLIIFS--LISIALAVS 22 (340)
Q Consensus 1 ~~~~~~~~~~~~~--~~~~~~~~~ 22 (340)
||||.+|++.++| +|.|+..++
T Consensus 1 MaSK~~llL~l~LA~lLlisSeva 24 (95)
T PF07172_consen 1 MASKAFLLLGLLLAALLLISSEVA 24 (95)
T ss_pred CchhHHHHHHHHHHHHHHHHhhhh
Confidence 9999444333333 344444443
No 10
>PF10731 Anophelin: Thrombin inhibitor from mosquito; InterPro: IPR018932 Members of this family are all inhibitors of thrombin, the peptidase that is at the end of the blood coagulation cascade and which creates the clot by cleaving fibrinogen. The interaction between thrombin and fibrinogen involves two different areas of contact - via the thrombin active site and via a second substrate-binding site known as an exosite. The inhibitor acts by blocking the exosite, rather than by interacting with the active site. The inhibitors are from mosquitoes that feed on human blood and which, by inhibiting thrombin, prevent the blood from clotting and keep it flowing.
Probab=34.79 E-value=35 Score=24.90 Aligned_cols=22 Identities=18% Similarity=0.318 Sum_probs=14.1
Q ss_pred CcchhhHHHHHHHH-HhhhhhcC
Q 019462 1 MATLIIFSLIIFSL-ISIALAVS 22 (340)
Q Consensus 1 ~~~~~~~~~~~~~~-~~~~~~~~ 22 (340)
||+++++..+|... +.++.++|
T Consensus 1 MA~Kl~vialLC~aLva~vQ~AP 23 (65)
T PF10731_consen 1 MASKLIVIALLCVALVAIVQSAP 23 (65)
T ss_pred CcchhhHHHHHHHHHHHHHhcCc
Confidence 99997666555553 55556655
Done!