Query 001000
Match_columns 1193
No_of_seqs 308 out of 2031
Neff 4.5
Searched_HMMs 46136
Date Thu Mar 28 13:00:25 2013
Command hhsearch -i /work/01045/syshi/csienesis_hhblits_a3m/001000.a3m -d /work/01045/syshi/HHdatabase/Cdd.hhm -o /work/01045/syshi/hhsearch_cdd/001000hhsearch_cdd -cpu 12 -v 0
No Hit Prob E-value P-value Score SS Cols Query HMM Template HMM
1 KOG2462 C2H2-type Zn-finger pr 99.9 3.2E-22 7E-27 216.6 6.8 134 1044-1183 126-265 (279)
2 KOG2462 C2H2-type Zn-finger pr 99.7 2E-18 4.3E-23 187.4 6.2 110 1073-1192 127-244 (279)
3 KOG1074 Transcriptional repres 99.4 6.2E-14 1.3E-18 168.3 4.4 78 1104-1187 608-692 (958)
4 KOG1074 Transcriptional repres 99.4 4.5E-14 9.8E-19 169.5 3.2 77 1047-1125 604-692 (958)
5 KOG3623 Homeobox transcription 99.2 5.3E-12 1.1E-16 149.7 1.6 102 1076-1183 210-331 (1007)
6 KOG3623 Homeobox transcription 99.2 4.5E-12 9.7E-17 150.3 1.0 77 1102-1182 895-971 (1007)
7 KOG3608 Zn finger proteins [Ge 99.1 3.6E-11 7.7E-16 134.2 5.4 133 1052-1190 183-349 (467)
8 KOG3576 Ovo and related transc 99.1 4E-11 8.7E-16 126.0 3.3 106 1073-1184 114-235 (267)
9 KOG3576 Ovo and related transc 99.1 2.1E-11 4.6E-16 128.1 -0.6 79 1101-1183 117-195 (267)
10 KOG3608 Zn finger proteins [Ge 98.9 4.8E-10 1E-14 125.3 3.4 139 1047-1193 236-383 (467)
11 PHA00733 hypothetical protein 98.5 5.7E-08 1.2E-12 97.4 4.3 98 1063-1187 27-124 (128)
12 PLN03086 PRLI-interacting fact 98.4 3.1E-07 6.7E-12 110.7 7.8 99 1075-1184 452-563 (567)
13 PLN03086 PRLI-interacting fact 98.4 3.9E-07 8.5E-12 109.8 7.7 121 1048-1184 407-537 (567)
14 PHA02768 hypothetical protein; 98.1 2.1E-06 4.6E-11 74.6 2.3 44 1129-1178 5-48 (55)
15 KOG3993 Transcription factor ( 97.9 2E-06 4.3E-11 99.0 -1.0 133 1046-1184 265-481 (500)
16 PF13465 zf-H2C2_2: Zinc-finge 97.8 1E-05 2.2E-10 60.2 2.3 26 1146-1173 1-26 (26)
17 PHA02768 hypothetical protein; 97.7 1.5E-05 3.2E-10 69.5 2.1 43 1102-1148 6-48 (55)
18 PHA00733 hypothetical protein 97.5 7.9E-05 1.7E-09 75.1 4.4 79 1047-1155 39-123 (128)
19 KOG3993 Transcription factor ( 97.4 4.3E-05 9.4E-10 88.3 0.1 105 1076-1184 267-379 (500)
20 PF13465 zf-H2C2_2: Zinc-finge 97.1 0.0002 4.3E-09 53.4 1.1 26 1116-1143 1-26 (26)
21 PHA00616 hypothetical protein 96.8 0.00055 1.2E-08 57.4 1.7 34 1129-1164 1-34 (44)
22 PHA00732 hypothetical protein 96.8 0.001 2.2E-08 62.1 3.2 20 1103-1122 3-22 (79)
23 COG5189 SFP1 Putative transcri 96.1 0.0022 4.7E-08 72.5 1.4 25 1156-1182 395-419 (423)
24 PHA00732 hypothetical protein 96.0 0.0051 1.1E-07 57.5 3.3 45 1129-1183 1-46 (79)
25 PHA00616 hypothetical protein 96.0 0.0027 5.7E-08 53.4 1.1 30 1159-1192 1-30 (44)
26 COG5189 SFP1 Putative transcri 96.0 0.002 4.2E-08 72.8 0.2 72 1074-1152 347-419 (423)
27 PF12756 zf-C2H2_2: C2H2 type 95.6 0.0083 1.8E-07 55.6 2.8 76 1104-1189 2-78 (100)
28 COG5048 FOG: Zn-finger [Genera 95.4 0.0092 2E-07 67.1 2.7 137 1047-1183 288-440 (467)
29 PF05605 zf-Di19: Drought indu 95.0 0.03 6.5E-07 48.4 4.2 49 1129-1184 2-52 (54)
30 PF00096 zf-C2H2: Zinc finger, 94.7 0.018 3.9E-07 41.0 1.7 22 1160-1183 1-22 (23)
31 PF13912 zf-C2H2_6: C2H2-type 93.7 0.042 9.2E-07 40.6 1.8 24 1159-1184 1-24 (27)
32 PF13894 zf-C2H2_4: C2H2-type 93.3 0.061 1.3E-06 37.7 2.1 23 1160-1184 1-23 (24)
33 PF00096 zf-C2H2: Zinc finger, 93.2 0.04 8.6E-07 39.2 1.1 23 1130-1154 1-23 (23)
34 PF05605 zf-Di19: Drought indu 92.3 0.22 4.7E-06 43.1 4.5 49 1102-1155 3-53 (54)
35 PRK04860 hypothetical protein; 91.3 0.11 2.4E-06 54.7 2.0 39 1128-1174 118-156 (160)
36 COG5048 FOG: Zn-finger [Genera 90.9 0.086 1.9E-06 59.4 0.8 75 1101-1175 289-367 (467)
37 PF12756 zf-C2H2_2: C2H2 type 90.5 0.15 3.2E-06 47.4 1.8 72 1078-1154 1-73 (100)
38 PF13912 zf-C2H2_6: C2H2-type 88.8 0.19 4.2E-06 37.1 1.0 25 1129-1155 1-25 (27)
39 smart00355 ZnF_C2H2 zinc finge 88.7 0.3 6.5E-06 34.4 1.9 22 1160-1183 1-22 (26)
40 smart00355 ZnF_C2H2 zinc finge 87.8 0.54 1.2E-05 33.0 2.7 24 1130-1155 1-24 (26)
41 PF13894 zf-C2H2_4: C2H2-type 87.5 0.35 7.6E-06 33.8 1.6 23 1130-1154 1-23 (24)
42 PF12874 zf-met: Zinc-finger o 83.0 0.52 1.1E-05 34.2 0.8 24 1160-1185 1-24 (25)
43 PF09237 GAGA: GAGA factor; I 82.0 0.83 1.8E-05 40.0 1.7 26 1156-1183 21-46 (54)
44 PRK04860 hypothetical protein; 81.7 0.71 1.5E-05 48.8 1.5 39 1100-1144 118-156 (160)
45 PF12171 zf-C2H2_jaz: Zinc-fin 75.4 1 2.2E-05 33.6 0.3 25 1160-1186 2-26 (27)
46 PF09237 GAGA: GAGA factor; I 75.4 2 4.4E-05 37.7 2.1 40 1118-1159 12-52 (54)
47 KOG2231 Predicted E3 ubiquitin 74.0 3.6 7.8E-05 52.0 4.6 120 1050-1182 117-260 (669)
48 KOG1146 Homeobox protein [Gene 69.5 1.9 4E-05 57.4 0.8 91 1084-1188 442-545 (1406)
49 KOG1146 Homeobox protein [Gene 68.6 1.3 2.8E-05 58.8 -0.8 94 1077-1189 1261-1356(1406)
50 PF12874 zf-met: Zinc-finger o 61.9 3.7 7.9E-05 29.7 0.8 23 1130-1154 1-23 (25)
51 PF13909 zf-H2C2_5: C2H2-type 61.3 5.5 0.00012 28.8 1.6 22 1160-1184 1-22 (24)
52 KOG2231 Predicted E3 ubiquitin 60.2 9.1 0.0002 48.6 4.2 98 1078-1184 117-235 (669)
53 KOG2893 Zn finger protein [Gen 58.9 3.2 6.8E-05 46.3 0.0 37 1084-1120 16-53 (341)
54 KOG4377 Zn-finger protein [Gen 58.3 4.8 0.0001 48.0 1.3 107 1075-1184 270-426 (480)
55 KOG4173 Alpha-SNAP protein [In 57.5 2.5 5.4E-05 46.3 -1.0 81 1075-1155 78-171 (253)
56 KOG4124 Putative transcription 56.9 3.5 7.5E-05 48.2 -0.1 105 1073-1180 175-417 (442)
57 smart00451 ZnF_U1 U1-like zinc 55.4 7 0.00015 30.3 1.4 26 1159-1186 3-28 (35)
58 PF12171 zf-C2H2_jaz: Zinc-fin 48.1 6.6 0.00014 29.3 0.2 22 1130-1153 2-23 (27)
59 KOG4173 Alpha-SNAP protein [In 46.9 6.3 0.00014 43.3 -0.0 79 1101-1184 81-169 (253)
60 PF13909 zf-H2C2_5: C2H2-type 44.8 13 0.00028 26.9 1.3 22 1130-1154 1-22 (24)
61 PF13913 zf-C2HC_2: zinc-finge 41.2 19 0.00042 27.0 1.8 20 1161-1183 4-23 (25)
62 TIGR00622 ssl1 transcription f 40.1 46 0.001 33.8 4.8 21 1075-1097 14-34 (112)
63 KOG2893 Zn finger protein [Gen 32.5 14 0.00031 41.4 -0.1 38 1137-1180 16-53 (341)
64 COG5236 Uncharacterized conser 30.9 40 0.00088 39.8 3.1 29 1079-1109 223-252 (493)
65 PF07800 DUF1644: Protein of u 30.1 1.5E+02 0.0033 31.9 6.8 59 1128-1192 79-138 (162)
66 COG5236 Uncharacterized conser 29.8 32 0.00069 40.6 2.0 109 1061-1183 166-303 (493)
67 PF14597 Lactamase_B_5: Metall 29.5 33 0.00071 37.7 1.9 39 345-386 43-81 (199)
68 KOG4377 Zn-finger protein [Gen 28.6 20 0.00043 43.1 0.2 101 1052-1155 277-427 (480)
69 PF13913 zf-C2HC_2: zinc-finge 27.0 56 0.0012 24.6 2.2 19 1131-1152 4-22 (25)
70 smart00451 ZnF_U1 U1-like zinc 26.5 43 0.00093 25.9 1.7 23 1129-1153 3-25 (35)
71 KOG2482 Predicted C2H2-type Zn 22.3 62 0.0014 38.4 2.6 104 1077-1188 196-361 (423)
72 PF04273 DUF442: Putative phos 21.6 96 0.0021 31.1 3.4 59 350-410 21-84 (110)
No 1
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.86 E-value=3.2e-22 Score=216.62 Aligned_cols=134 Identities=22% Similarity=0.440 Sum_probs=126.1
Q ss_pred CCCCccccccCCcccccCcccccccccccC---CCccccCCCCCCCcccChhHHhhhhccc---cCcCCCCCcccChhHH
Q 001000 1044 EKNPAAKKKVKNASVVKAPAGLNNAKIKDE---EAGYHCDMEGCTMSFGTKQELVLHKKNI---CPVKGCGKKFFSHKYL 1117 (1193)
Q Consensus 1044 ~k~~k~kC~iC~k~f~kk~~L~~H~riHtg---EKpyqCdiegCGKsFssks~Lk~Hkr~h---CpCe~CgKsFsskssL 1117 (1193)
.+...++|..|++.+.....|.+|..+|.. .+.+.|.+ |||.|.....|..|+++| |.|.+|||.|.+.+.|
T Consensus 126 ~~~~r~~c~eCgk~ysT~snLsrHkQ~H~~~~s~ka~~C~~--C~K~YvSmpALkMHirTH~l~c~C~iCGKaFSRPWLL 203 (279)
T KOG2462|consen 126 AKHPRYKCPECGKSYSTSSNLSRHKQTHRSLDSKKAFSCKY--CGKVYVSMPALKMHIRTHTLPCECGICGKAFSRPWLL 203 (279)
T ss_pred ccCCceeccccccccccccccchhhcccccccccccccCCC--CCceeeehHHHhhHhhccCCCcccccccccccchHHh
Confidence 356788999999999999999999999974 57799988 999999999999999976 9999999999999999
Q ss_pred HhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhh
Q 001000 1118 VQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1118 q~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
+.|+|+|||||||.| ..|+|+|..+++|+.||++|.+.|+|+|.. |+|+|+..+-|.+|...
T Consensus 204 QGHiRTHTGEKPF~C--~hC~kAFADRSNLRAHmQTHS~~K~~qC~~--C~KsFsl~SyLnKH~ES 265 (279)
T KOG2462|consen 204 QGHIRTHTGEKPFSC--PHCGKAFADRSNLRAHMQTHSDVKKHQCPR--CGKSFALKSYLNKHSES 265 (279)
T ss_pred hcccccccCCCCccC--CcccchhcchHHHHHHHHhhcCCccccCcc--hhhHHHHHHHHHHhhhh
Confidence 999999999999999 669999999999999999999999999988 99999999999999865
No 2
>KOG2462 consensus C2H2-type Zn-finger protein [Transcription]
Probab=99.73 E-value=2e-18 Score=187.43 Aligned_cols=110 Identities=35% Similarity=0.664 Sum_probs=101.4
Q ss_pred CCCccccCCCCCCCcccChhHHhhhhccc--------cCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccCh
Q 001000 1073 EEAGYHCDMEGCTMSFGTKQELVLHKKNI--------CPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWA 1144 (1193)
Q Consensus 1073 gEKpyqCdiegCGKsFssks~Lk~Hkr~h--------CpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~k 1144 (1193)
....|+|.. ||+.+.+.++|.+|+.+| +.|+.|+|.|..-..|..|+++|+ -|++| .+|||.|...
T Consensus 127 ~~~r~~c~e--Cgk~ysT~snLsrHkQ~H~~~~s~ka~~C~~C~K~YvSmpALkMHirTH~--l~c~C--~iCGKaFSRP 200 (279)
T KOG2462|consen 127 KHPRYKCPE--CGKSYSTSSNLSRHKQTHRSLDSKKAFSCKYCGKVYVSMPALKMHIRTHT--LPCEC--GICGKAFSRP 200 (279)
T ss_pred cCCceeccc--cccccccccccchhhcccccccccccccCCCCCceeeehHHHhhHhhccC--CCccc--ccccccccch
Confidence 345699986 999999999999999877 469999999999999999999998 68899 6799999999
Q ss_pred HHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhhhcCCCCCCC
Q 001000 1145 WARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRKTGHSAKKSR 1192 (1193)
Q Consensus 1145 S~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rth~HsgeK~~ 1192 (1193)
+-|+.|+|+|||||||.|.. |+|+|+.+++|+.||++ |++.|+|
T Consensus 201 WLLQGHiRTHTGEKPF~C~h--C~kAFADRSNLRAHmQT--HS~~K~~ 244 (279)
T KOG2462|consen 201 WLLQGHIRTHTGEKPFSCPH--CGKAFADRSNLRAHMQT--HSDVKKH 244 (279)
T ss_pred HHhhcccccccCCCCccCCc--ccchhcchHHHHHHHHh--hcCCccc
Confidence 99999999999999999987 99999999999999999 7777765
No 3
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.43 E-value=6.2e-14 Score=168.33 Aligned_cols=78 Identities=27% Similarity=0.465 Sum_probs=63.8
Q ss_pred cCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCC----ceecC---CCCcCCcccChhh
Q 001000 1104 VKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGAR----PYVCA---EPGCGQTFRFVSD 1176 (1193)
Q Consensus 1104 Ce~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEK----PYkC~---epGCGKsFs~sSs 1176 (1193)
|-+|-+...-.+.|+.|.|+|+|||||+| ++||++|.++.+|+.||-+|.... +|.|+ + |-+.|...-.
T Consensus 608 CiiC~rVlSC~saLqmHyrtHtGERPFkC--KiCgRAFtTkGNLkaH~~vHka~p~~R~q~ScP~~~i--c~~kftn~V~ 683 (958)
T KOG1074|consen 608 CIICLRVLSCPSALQMHYRTHTGERPFKC--KICGRAFTTKGNLKAHMSVHKAKPPARVQFSCPSTFI--CQKKFTNAVT 683 (958)
T ss_pred eeeeeecccchhhhhhhhhcccCcCcccc--ccccchhccccchhhcccccccCccccccccCCchhh--hccccccccc
Confidence 55588888888888888888888888888 778888888888888888886543 46786 6 8888888888
Q ss_pred HHHhhhhhcCC
Q 001000 1177 FSRHKRKTGHS 1187 (1193)
Q Consensus 1177 L~rH~Rth~Hs 1187 (1193)
|..|+|+ |.
T Consensus 684 lpQhIri--H~ 692 (958)
T KOG1074|consen 684 LPQHIRI--HL 692 (958)
T ss_pred ccceEEe--ec
Confidence 8888887 55
No 4
>KOG1074 consensus Transcriptional repressor SALM [Transcription]
Probab=99.43 E-value=4.5e-14 Score=169.46 Aligned_cols=77 Identities=25% Similarity=0.299 Sum_probs=69.6
Q ss_pred CccccccCCcccccCcccccccccccCCCccccCCCCCCCcccChhHHhhhhccc---------cCcC---CCCCcccCh
Q 001000 1047 PAAKKKVKNASVVKAPAGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKNI---------CPVK---GCGKKFFSH 1114 (1193)
Q Consensus 1047 ~k~kC~iC~k~f~kk~~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~h---------CpCe---~CgKsFssk 1114 (1193)
..-.|-+|.+.......|.-|.++|+||+||+|.+ ||+.|.++.+|+.|+-.| +.|+ .|-+.|...
T Consensus 604 dPNqCiiC~rVlSC~saLqmHyrtHtGERPFkCKi--CgRAFtTkGNLkaH~~vHka~p~~R~q~ScP~~~ic~~kftn~ 681 (958)
T KOG1074|consen 604 DPNQCIICLRVLSCPSALQMHYRTHTGERPFKCKI--CGRAFTTKGNLKAHMSVHKAKPPARVQFSCPSTFICQKKFTNA 681 (958)
T ss_pred CccceeeeeecccchhhhhhhhhcccCcCcccccc--ccchhccccchhhcccccccCccccccccCCchhhhccccccc
Confidence 34569999999999999999999999999999999 999999999999996543 6788 899999999
Q ss_pred hHHHhhhhhcc
Q 001000 1115 KYLVQHRRVHL 1125 (1193)
Q Consensus 1115 ssLq~HqRvHt 1125 (1193)
-.|.+|+++|.
T Consensus 682 V~lpQhIriH~ 692 (958)
T KOG1074|consen 682 VTLPQHIRIHL 692 (958)
T ss_pred ccccceEEeec
Confidence 99999998887
No 5
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.18 E-value=5.3e-12 Score=149.71 Aligned_cols=102 Identities=26% Similarity=0.533 Sum_probs=86.3
Q ss_pred ccccCCCCCCCcccChhHHhhhhcc-------ccCcCCCCCcccChhHHHhhhhhcc-------------CCCCCCCCCC
Q 001000 1076 GYHCDMEGCTMSFGTKQELVLHKKN-------ICPVKGCGKKFFSHKYLVQHRRVHL-------------DDRPLKCPWK 1135 (1193)
Q Consensus 1076 pyqCdiegCGKsFssks~Lk~Hkr~-------hCpCe~CgKsFsskssLq~HqRvHt-------------GEKPykCp~~ 1135 (1193)
...|++ |.+.+.+...|+.|+++ .++|..|..+|.+...|-+|+.+|. .-|.|+| .
T Consensus 210 lltcpy--cdrgykrltslkeHikyrhekne~nfsC~lCsytFAyRtQLErhm~~hkpg~dqa~sltqsa~lRKFKC--t 285 (1007)
T KOG3623|consen 210 LLTCPY--CDRGYKRLTSLKEHIKYRHEKNEPNFSCMLCSYTFAYRTQLERHMQLHKPGGDQAISLTQSALLRKFKC--T 285 (1007)
T ss_pred hhcchh--HHHHHHHHHHHHHHHHHHHhhCCCCCcchhhhhhhhhHHHHHHHHHhhcCCCcccccccchhhhccccc--c
Confidence 356777 88888888888888653 2778888888888888888887774 2477999 7
Q ss_pred CCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhh
Q 001000 1136 GCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1136 eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
+|||+|..+.+|+.|+|+|.|||||.|.. |+|.|....++..||..
T Consensus 286 ECgKAFKfKHHLKEHlRIHSGEKPfeCpn--CkKRFSHSGSySSHmSS 331 (1007)
T KOG3623|consen 286 ECGKAFKFKHHLKEHLRIHSGEKPFECPN--CKKRFSHSGSYSSHMSS 331 (1007)
T ss_pred ccchhhhhHHHHHhhheeecCCCCcCCcc--cccccccCCcccccccc
Confidence 89999999999999999999999999977 99999999999999875
No 6
>KOG3623 consensus Homeobox transcription factor SIP1 [Transcription]
Probab=99.18 E-value=4.5e-12 Score=150.28 Aligned_cols=77 Identities=32% Similarity=0.678 Sum_probs=73.2
Q ss_pred cCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhh
Q 001000 1102 CPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHK 1181 (1193)
Q Consensus 1102 CpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~ 1181 (1193)
|.|..|.|.|...+.|.+|.--|+|.|||+| .+|.|+|.++.+|..|+|.|.|||||+|.. |+|.|....++.+||
T Consensus 895 yaCDqCDK~FqKqSSLaRHKYEHsGqRPyqC--~iCkKAFKHKHHLtEHkRLHSGEKPfQCdK--ClKRFSHSGSYSQHM 970 (1007)
T KOG3623|consen 895 YACDQCDKAFQKQSSLARHKYEHSGQRPYQC--IICKKAFKHKHHLTEHKRLHSGEKPFQCDK--CLKRFSHSGSYSQHM 970 (1007)
T ss_pred chHHHHHHHHHhhHHHHHhhhhhcCCCCccc--chhhHhhhhhhhhhhhhhhccCCCcchhhh--hhhhcccccchHhhh
Confidence 6677799999999999999999999999999 889999999999999999999999999988 999999999999998
Q ss_pred h
Q 001000 1182 R 1182 (1193)
Q Consensus 1182 R 1182 (1193)
-
T Consensus 971 N 971 (1007)
T KOG3623|consen 971 N 971 (1007)
T ss_pred c
Confidence 5
No 7
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=99.14 E-value=3.6e-11 Score=134.20 Aligned_cols=133 Identities=23% Similarity=0.377 Sum_probs=90.5
Q ss_pred ccCCcccccCcccccccccccCCCccccCCCCCCCcccChhHHhhhhc------------------------------c-
Q 001000 1052 KVKNASVVKAPAGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKK------------------------------N- 1100 (1193)
Q Consensus 1052 ~iC~k~f~kk~~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr------------------------------~- 1100 (1193)
.-|.+.+..+..|..|.+.|++++...|+. ||..|..+..|..|.+ +
T Consensus 183 ~~Ct~~~~~k~~LreH~r~Hs~eKvvACp~--Cg~~F~~~tkl~DH~rRqt~l~~n~fqC~~C~KrFaTeklL~~Hv~rH 260 (467)
T KOG3608|consen 183 AMCTKHMGNKYRLREHIRTHSNEKVVACPH--CGELFRTKTKLFDHLRRQTELNTNSFQCAQCFKRFATEKLLKSHVVRH 260 (467)
T ss_pred hhhhhhhccHHHHHHHHHhcCCCeEEecch--HHHHhccccHHHHHHHhhhhhcCCchHHHHHHHHHhHHHHHHHHHHHh
Confidence 346666666666666666666666666665 6666666666655533 2
Q ss_pred --ccCcCCCCCcccChhHHHhhhhh-ccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhH
Q 001000 1101 --ICPVKGCGKKFFSHKYLVQHRRV-HLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDF 1177 (1193)
Q Consensus 1101 --hCpCe~CgKsFsskssLq~HqRv-HtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL 1177 (1193)
+|.|+.|..+....+.|..|++. |...|||+| ..|.+.|...+.|..|..+|+ +.-|.|..|.|..+|++...+
T Consensus 261 vn~ykCplCdmtc~~~ssL~~H~r~rHs~dkpfKC--d~Cd~~c~~esdL~kH~~~HS-~~~y~C~h~~C~~s~r~~~q~ 337 (467)
T KOG3608|consen 261 VNCYKCPLCDMTCSSASSLTTHIRYRHSKDKPFKC--DECDTRCVRESDLAKHVQVHS-KTVYQCEHPDCHYSVRTYTQM 337 (467)
T ss_pred hhcccccccccCCCChHHHHHHHHhhhccCCCccc--cchhhhhccHHHHHHHHHhcc-ccceecCCCCCcHHHHHHHHH
Confidence 26677777777777777777774 777777877 677777777777777777776 555777777777777777777
Q ss_pred HHhhhhhcCCCCC
Q 001000 1178 SRHKRKTGHSAKK 1190 (1193)
Q Consensus 1178 ~rH~Rth~HsgeK 1190 (1193)
.+|++.+ |.|-.
T Consensus 338 ~~H~~ev-hEg~n 349 (467)
T KOG3608|consen 338 RRHFLEV-HEGNN 349 (467)
T ss_pred HHHHHHh-ccCCC
Confidence 7777763 54443
No 8
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.09 E-value=4e-11 Score=126.03 Aligned_cols=106 Identities=30% Similarity=0.536 Sum_probs=93.0
Q ss_pred CCCccccCCCCCCCcccChhHHhhhhccc-----cCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHH
Q 001000 1073 EEAGYHCDMEGCTMSFGTKQELVLHKKNI-----CPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWAR 1147 (1193)
Q Consensus 1073 gEKpyqCdiegCGKsFssks~Lk~Hkr~h-----CpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~L 1147 (1193)
+...|.|.+ |||.|....-|.+|++.| +-|..|||.|.....|.+|+++|+|.+||+| ..|+|+|.+.-.|
T Consensus 114 d~d~ftCrv--CgK~F~lQRmlnrh~kch~~vkr~lct~cgkgfndtfdlkrh~rthtgvrpykc--~~c~kaftqrcsl 189 (267)
T KOG3576|consen 114 DQDSFTCRV--CGKKFGLQRMLNRHLKCHSDVKRHLCTFCGKGFNDTFDLKRHTRTHTGVRPYKC--SLCEKAFTQRCSL 189 (267)
T ss_pred CCCeeeeeh--hhhhhhHHHHHHHHhhhccHHHHHHHhhccCcccchhhhhhhhccccCccccch--hhhhHHHHhhccH
Confidence 345689998 999999999999998765 4577799999999999999999999999999 7799999999999
Q ss_pred HHHHh-hhC----------CCCceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1148 TEHIR-VHT----------GARPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1148 krH~R-iHT----------GEKPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
..|.+ +|. .+|-|.|.. ||.+-.....+..|...|
T Consensus 190 eshl~kvhgv~~~yaykerr~kl~vced--cg~t~~~~e~~~~h~~~~ 235 (267)
T KOG3576|consen 190 ESHLKKVHGVQHQYAYKERRAKLYVCED--CGYTSERPEVYYLHLKLH 235 (267)
T ss_pred HHHHHHHcCchHHHHHHHhhhheeeecc--cCCCCCChhHHHHHHHhc
Confidence 99987 453 357899988 999998999999999884
No 9
>KOG3576 consensus Ovo and related transcription factors [Transcription]
Probab=99.06 E-value=2.1e-11 Score=128.08 Aligned_cols=79 Identities=32% Similarity=0.620 Sum_probs=75.3
Q ss_pred ccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHh
Q 001000 1101 ICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRH 1180 (1193)
Q Consensus 1101 hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH 1180 (1193)
.+.|..|+|.|.....|.+|++.|...+.|-|.+ |||.|.....|.+|+|+|||.+||+|.. |+|+|.++.+|..|
T Consensus 117 ~ftCrvCgK~F~lQRmlnrh~kch~~vkr~lct~--cgkgfndtfdlkrh~rthtgvrpykc~~--c~kaftqrcslesh 192 (267)
T KOG3576|consen 117 SFTCRVCGKKFGLQRMLNRHLKCHSDVKRHLCTF--CGKGFNDTFDLKRHTRTHTGVRPYKCSL--CEKAFTQRCSLESH 192 (267)
T ss_pred eeeeehhhhhhhHHHHHHHHhhhccHHHHHHHhh--ccCcccchhhhhhhhccccCccccchhh--hhHHHHhhccHHHH
Confidence 4678999999999999999999999999999965 9999999999999999999999999998 99999999999999
Q ss_pred hhh
Q 001000 1181 KRK 1183 (1193)
Q Consensus 1181 ~Rt 1183 (1193)
.+.
T Consensus 193 l~k 195 (267)
T KOG3576|consen 193 LKK 195 (267)
T ss_pred HHH
Confidence 886
No 10
>KOG3608 consensus Zn finger proteins [General function prediction only]
Probab=98.92 E-value=4.8e-10 Score=125.34 Aligned_cols=139 Identities=18% Similarity=0.291 Sum_probs=119.3
Q ss_pred CccccccCCcccccCcccccccccccCCCccccCCCCCCCcccChhHHhhhhcc------ccCcCCCCCcccChhHHHhh
Q 001000 1047 PAAKKKVKNASVVKAPAGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKN------ICPVKGCGKKFFSHKYLVQH 1120 (1193)
Q Consensus 1047 ~k~kC~iC~k~f~kk~~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~------hCpCe~CgKsFsskssLq~H 1120 (1193)
..+.|..|.+.|.....|.-|+..|- .-|+|+. |..+....+.|..|+++ +++|..|.+.|.+.+.|..|
T Consensus 236 n~fqC~~C~KrFaTeklL~~Hv~rHv--n~ykCpl--Cdmtc~~~ssL~~H~r~rHs~dkpfKCd~Cd~~c~~esdL~kH 311 (467)
T KOG3608|consen 236 NSFQCAQCFKRFATEKLLKSHVVRHV--NCYKCPL--CDMTCSSASSLTTHIRYRHSKDKPFKCDECDTRCVRESDLAKH 311 (467)
T ss_pred CchHHHHHHHHHhHHHHHHHHHHHhh--hcccccc--cccCCCChHHHHHHHHhhhccCCCccccchhhhhccHHHHHHH
Confidence 36778888888888888888887776 4688988 99999999999999874 58999999999999999999
Q ss_pred hhhccCCCCCCCCCCCCCccccChHHHHHHHhh-hCC--CCceecCCCCcCCcccChhhHHHhhhhhcCCCCCCCC
Q 001000 1121 RRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRV-HTG--ARPYVCAEPGCGQTFRFVSDFSRHKRKTGHSAKKSRG 1193 (1193)
Q Consensus 1121 qRvHtGEKPykCp~~eCGKtFs~kS~LkrH~Ri-HTG--EKPYkC~epGCGKsFs~sSsL~rH~Rth~HsgeK~~G 1193 (1193)
..+|. +.-|.|.++.|...|.+...+.+|++- |.| .-+|.|.. |.+.|+.-.+|..|.++ .|.-+=|+|
T Consensus 312 ~~~HS-~~~y~C~h~~C~~s~r~~~q~~~H~~evhEg~np~~Y~CH~--Cdr~ft~G~~L~~HL~k-kH~f~~PsG 383 (467)
T KOG3608|consen 312 VQVHS-KTVYQCEHPDCHYSVRTYTQMRRHFLEVHEGNNPILYACHC--CDRFFTSGKSLSAHLMK-KHGFRLPSG 383 (467)
T ss_pred HHhcc-ccceecCCCCCcHHHHHHHHHHHHHHHhccCCCCCceeeec--chhhhccchhHHHHHHH-hhcccCCCC
Confidence 99999 778999777799999999999999985 545 45699999 99999999999999887 476666655
No 11
>PHA00733 hypothetical protein
Probab=98.54 E-value=5.7e-08 Score=97.40 Aligned_cols=98 Identities=22% Similarity=0.283 Sum_probs=74.3
Q ss_pred ccccccccccCCCccccCCCCCCCcccChhHHhhhhccccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCcccc
Q 001000 1063 AGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKNICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFK 1142 (1193)
Q Consensus 1063 ~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs 1142 (1193)
.|.++..+....+++.|.+ |.+.|.....|..| ..|..|+.+| +.+||.| ..||+.|.
T Consensus 27 ~~~~~~~~~~~~~~~~~~~--~~~~~~~~~~l~~~-----------------~~l~~~~~~~-~~kPy~C--~~Cgk~Fs 84 (128)
T PHA00733 27 ELKRYHSLTPEQKRLIRAV--VKTLIYNPQLLDES-----------------SYLYKLLTSK-AVSPYVC--PLCLMPFS 84 (128)
T ss_pred HhhhhhcCChhhhhHHHHH--HhhhccChhhhcch-----------------HHHHhhcccC-CCCCccC--CCCCCcCC
Confidence 3444444445567788887 77777655444333 3366665444 5899999 77999999
Q ss_pred ChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhhhcCC
Q 001000 1143 WAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRKTGHS 1187 (1193)
Q Consensus 1143 ~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rth~Hs 1187 (1193)
....|..|+++| +.+|.|.. |++.|.....|..|++.. |.
T Consensus 85 s~s~L~~H~r~h--~~~~~C~~--CgK~F~~~~sL~~H~~~~-h~ 124 (128)
T PHA00733 85 SSVSLKQHIRYT--EHSKVCPV--CGKEFRNTDSTLDHVCKK-HN 124 (128)
T ss_pred CHHHHHHHHhcC--CcCccCCC--CCCccCCHHHHHHHHHHh-cC
Confidence 999999999987 46899988 999999999999999983 54
No 12
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.44 E-value=3.1e-07 Score=110.68 Aligned_cols=99 Identities=23% Similarity=0.467 Sum_probs=74.1
Q ss_pred CccccCCCCCCCcccChhHHhhhhcc---ccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccC--------
Q 001000 1075 AGYHCDMEGCTMSFGTKQELVLHKKN---ICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKW-------- 1143 (1193)
Q Consensus 1075 KpyqCdiegCGKsFssks~Lk~Hkr~---hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~-------- 1143 (1193)
..+.|+. |++.|. ...|..|+.. ++.|+ |++.| .+..|..|+.+|...+|+.|+| |++.|..
T Consensus 452 ~H~~C~~--Cgk~f~-~s~LekH~~~~Hkpv~Cp-Cg~~~-~R~~L~~H~~thCp~Kpi~C~f--C~~~v~~g~~~~d~~ 524 (567)
T PLN03086 452 NHVHCEK--CGQAFQ-QGEMEKHMKVFHEPLQCP-CGVVL-EKEQMVQHQASTCPLRLITCRF--CGDMVQAGGSAMDVR 524 (567)
T ss_pred cCccCCC--CCCccc-hHHHHHHHHhcCCCccCC-CCCCc-chhHHHhhhhccCCCCceeCCC--CCCccccCccccchh
Confidence 3457877 888885 5778888764 35677 88655 5678888888888888899965 8888842
Q ss_pred --hHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1144 --AWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1144 --kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
...|..|+.++ |.+++.|.. ||+.|..+ .|..|+-..
T Consensus 525 d~~s~Lt~HE~~C-G~rt~~C~~--Cgk~Vrlr-dm~~H~~~~ 563 (567)
T PLN03086 525 DRLRGMSEHESIC-GSRTAPCDS--CGRSVMLK-EMDIHQIAV 563 (567)
T ss_pred hhhhhHHHHHHhc-CCcceEccc--cCCeeeeh-hHHHHHHHh
Confidence 35788888886 888889977 98888655 567776653
No 13
>PLN03086 PRLI-interacting factor K; Provisional
Probab=98.41 E-value=3.9e-07 Score=109.80 Aligned_cols=121 Identities=17% Similarity=0.313 Sum_probs=91.0
Q ss_pred ccccccCCcccccCcccccccccccCCCccccCCCCCCCcccChhHHhhhhccccCcCCCCCcccChhHHHhhhhhccCC
Q 001000 1048 AAKKKVKNASVVKAPAGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKNICPVKGCGKKFFSHKYLVQHRRVHLDD 1127 (1193)
Q Consensus 1048 k~kC~iC~k~f~kk~~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~hCpCe~CgKsFsskssLq~HqRvHtGE 1127 (1193)
...|..|....... .+..|... ..-..-.|+..+||..| .+..|..| +.|+.|++.|. ...|..|+.+|+
T Consensus 407 ~V~C~NC~~~i~l~-~l~lHe~~-C~r~~V~Cp~~~Cg~v~-~r~el~~H----~~C~~Cgk~f~-~s~LekH~~~~H-- 476 (567)
T PLN03086 407 TVECRNCKHYIPSR-SIALHEAY-CSRHNVVCPHDGCGIVL-RVEEAKNH----VHCEKCGQAFQ-QGEMEKHMKVFH-- 476 (567)
T ss_pred eEECCCCCCccchh-HHHHHHhh-CCCcceeCCccccccee-eccccccC----ccCCCCCCccc-hHHHHHHHHhcC--
Confidence 44677777765533 34455533 33345568755799999 34444444 57888999996 677999999975
Q ss_pred CCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCccc----------ChhhHHHhhhhh
Q 001000 1128 RPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFR----------FVSDFSRHKRKT 1184 (1193)
Q Consensus 1128 KPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs----------~sSsL~rH~Rth 1184 (1193)
+||.| + ||+.| ....|..|+++|..++|+.|.+ |++.|. ..+.|..|...+
T Consensus 477 kpv~C--p-Cg~~~-~R~~L~~H~~thCp~Kpi~C~f--C~~~v~~g~~~~d~~d~~s~Lt~HE~~C 537 (567)
T PLN03086 477 EPLQC--P-CGVVL-EKEQMVQHQASTCPLRLITCRF--CGDMVQAGGSAMDVRDRLRGMSEHESIC 537 (567)
T ss_pred CCccC--C-CCCCc-chhHHHhhhhccCCCCceeCCC--CCCccccCccccchhhhhhhHHHHHHhc
Confidence 89999 6 99765 6789999999999999999999 999995 246899999874
No 14
>PHA02768 hypothetical protein; Provisional
Probab=98.05 E-value=2.1e-06 Score=74.63 Aligned_cols=44 Identities=14% Similarity=0.255 Sum_probs=38.3
Q ss_pred CCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHH
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFS 1178 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~ 1178 (1193)
-|+| +.||+.|....+|..|+++|+ +||+|.. |++.|.+.+.|.
T Consensus 5 ~y~C--~~CGK~Fs~~~~L~~H~r~H~--k~~kc~~--C~k~f~~~s~l~ 48 (55)
T PHA02768 5 GYEC--PICGEIYIKRKSMITHLRKHN--TNLKLSN--CKRISLRTGEYI 48 (55)
T ss_pred ccCc--chhCCeeccHHHHHHHHHhcC--CcccCCc--ccceecccceeE
Confidence 3789 679999999999999999998 7999977 999999887764
No 15
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=97.89 E-value=2e-06 Score=98.99 Aligned_cols=133 Identities=20% Similarity=0.219 Sum_probs=99.0
Q ss_pred CCccccccCCcccccCcccccccccccCCCccccCCCCCCCcccChhHHhhhhccc------------------------
Q 001000 1046 NPAAKKKVKNASVVKAPAGLNNAKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKNI------------------------ 1101 (1193)
Q Consensus 1046 ~~k~kC~iC~k~f~kk~~L~~H~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~h------------------------ 1101 (1193)
..-+.|.+|...|.....|.+|.-.-.-.-.|.|.. |+|.|.+..+|-.|+|+|
T Consensus 265 iGdyiCqLCK~kYeD~F~LAQHrC~RIV~vEYrCPE--C~KVFsCPANLASHRRWHKPR~eaa~a~~~P~k~~~~~rae~ 342 (500)
T KOG3993|consen 265 IGDYICQLCKEKYEDAFALAQHRCPRIVHVEYRCPE--CDKVFSCPANLASHRRWHKPRPEAAKAGSPPPKQAVETRAEV 342 (500)
T ss_pred HHHHHHHHHHHhhhhHHHHhhccCCeeEEeeecCCc--ccccccCchhhhhhhcccCCchhhhhcCCCChhhhhhhhhhh
Confidence 356789999999999999999975444445799986 999999999999997742
Q ss_pred --------------cCcCCCCCcccChhHHHhhhhhccCC---C---C--------------------------------
Q 001000 1102 --------------CPVKGCGKKFFSHKYLVQHRRVHLDD---R---P-------------------------------- 1129 (1193)
Q Consensus 1102 --------------CpCe~CgKsFsskssLq~HqRvHtGE---K---P-------------------------------- 1129 (1193)
|.|..|+|.|.+...|+.|+.+|... + +
T Consensus 343 ~ea~rsg~dss~gi~~C~~C~KkFrRqAYLrKHqlthq~~~~~k~~a~~f~~s~~~~l~~~~~~~a~h~~a~~~~g~~vl 422 (500)
T KOG3993|consen 343 QEAERSGDDSSSGIFSCHTCGKKFRRQAYLRKHQLTHQRAPLAKEKAPKFLLSRVIPLMHFNQAVATHSSASDSHGDEVL 422 (500)
T ss_pred hhccccCCcccCceeecHHhhhhhHHHHHHHHhHHhhhccccchhcccCcchhhccccccccccccccccccccccccee
Confidence 56888999999999999998776531 0 0
Q ss_pred --------CCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1130 --------LKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1130 --------ykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
..| ..||-.+..+..--.|.|.-..+.-|.|.. |--+|.....|.+|+..+
T Consensus 423 ~~a~sael~~p--p~~~~ppsss~~sgg~~rlg~~~q~f~~ky--~~atfyss~~ltrhin~~ 481 (500)
T KOG3993|consen 423 YVAGSAELELP--PYDGSPPSSSGSSGGYGRLGIAEQGFTCKY--CPATFYSSPGLTRHINKC 481 (500)
T ss_pred eeeccccccCC--CCCCCCcccCCCCCccccccchhhcccccc--chHhhhcCcchHhHhhhc
Confidence 123 224544444444444444333445588988 999999999999999885
No 16
>PF13465 zf-H2C2_2: Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.83 E-value=1e-05 Score=60.19 Aligned_cols=26 Identities=42% Similarity=0.977 Sum_probs=22.6
Q ss_pred HHHHHHhhhCCCCceecCCCCcCCcccC
Q 001000 1146 ARTEHIRVHTGARPYVCAEPGCGQTFRF 1173 (1193)
Q Consensus 1146 ~LkrH~RiHTGEKPYkC~epGCGKsFs~ 1173 (1193)
+|.+|+++|+|++||.|+. |+++|.+
T Consensus 1 ~l~~H~~~H~~~k~~~C~~--C~k~F~~ 26 (26)
T PF13465_consen 1 NLRRHMRTHTGEKPYKCPY--CGKSFSN 26 (26)
T ss_dssp HHHHHHHHHSSSSSEEESS--SSEEESS
T ss_pred CHHHHhhhcCCCCCCCCCC--CcCeeCc
Confidence 5789999999999999988 9999864
No 17
>PHA02768 hypothetical protein; Provisional
Probab=97.73 E-value=1.5e-05 Score=69.49 Aligned_cols=43 Identities=23% Similarity=0.312 Sum_probs=38.3
Q ss_pred cCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHH
Q 001000 1102 CPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWART 1148 (1193)
Q Consensus 1102 CpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~Lk 1148 (1193)
|.|+.||+.|.....|..|+++|+ +||+| ..|++.|...+.|.
T Consensus 6 y~C~~CGK~Fs~~~~L~~H~r~H~--k~~kc--~~C~k~f~~~s~l~ 48 (55)
T PHA02768 6 YECPICGEIYIKRKSMITHLRKHN--TNLKL--SNCKRISLRTGEYI 48 (55)
T ss_pred cCcchhCCeeccHHHHHHHHHhcC--CcccC--CcccceecccceeE
Confidence 578889999999999999999999 79999 77999999877664
No 18
>PHA00733 hypothetical protein
Probab=97.54 E-value=7.9e-05 Score=75.07 Aligned_cols=79 Identities=18% Similarity=0.229 Sum_probs=51.6
Q ss_pred CccccccCCcccccCcccccc------cccccCCCccccCCCCCCCcccChhHHhhhhccccCcCCCCCcccChhHHHhh
Q 001000 1047 PAAKKKVKNASVVKAPAGLNN------AKIKDEEAGYHCDMEGCTMSFGTKQELVLHKKNICPVKGCGKKFFSHKYLVQH 1120 (1193)
Q Consensus 1047 ~k~kC~iC~k~f~kk~~L~~H------~riHtgEKpyqCdiegCGKsFssks~Lk~Hkr~hCpCe~CgKsFsskssLq~H 1120 (1193)
+...|.+|...|.....|..+ +.. .+.+||.|.. |++.|.....|..|
T Consensus 39 ~~~~~~~~~~~~~~~~~l~~~~~l~~~~~~-~~~kPy~C~~-------------------------Cgk~Fss~s~L~~H 92 (128)
T PHA00733 39 KRLIRAVVKTLIYNPQLLDESSYLYKLLTS-KAVSPYVCPL-------------------------CLMPFSSSVSLKQH 92 (128)
T ss_pred hhHHHHHHhhhccChhhhcchHHHHhhccc-CCCCCccCCC-------------------------CCCcCCCHHHHHHH
Confidence 456788888877765555443 222 2356677765 55555556666666
Q ss_pred hhhccCCCCCCCCCCCCCccccChHHHHHHHhhhC
Q 001000 1121 RRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHT 1155 (1193)
Q Consensus 1121 qRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHT 1155 (1193)
++.| ..+|.| ..|++.|.....|..|++...
T Consensus 93 ~r~h--~~~~~C--~~CgK~F~~~~sL~~H~~~~h 123 (128)
T PHA00733 93 IRYT--EHSKVC--PVCGKEFRNTDSTLDHVCKKH 123 (128)
T ss_pred HhcC--CcCccC--CCCCCccCCHHHHHHHHHHhc
Confidence 6655 346888 668888888888888887543
No 19
>KOG3993 consensus Transcription factor (contains Zn finger) [Transcription]
Probab=97.37 E-value=4.3e-05 Score=88.34 Aligned_cols=105 Identities=21% Similarity=0.324 Sum_probs=63.7
Q ss_pred ccccCCCCCCCcccChhHHhhhhc-----cccCcCCCCCcccChhHHHhhhhhccCCCCCC-CCCCCCCccccChHHHHH
Q 001000 1076 GYHCDMEGCTMSFGTKQELVLHKK-----NICPVKGCGKKFFSHKYLVQHRRVHLDDRPLK-CPWKGCKMTFKWAWARTE 1149 (1193)
Q Consensus 1076 pyqCdiegCGKsFssks~Lk~Hkr-----~hCpCe~CgKsFsskssLq~HqRvHtGEKPyk-Cp~~eCGKtFs~kS~Lkr 1149 (1193)
.|+|.. |...|.....|-+|+- ..|.|.+|+|.|.-..+|-.|+|.|.-..--. -...-=.+........+.
T Consensus 267 dyiCqL--CK~kYeD~F~LAQHrC~RIV~vEYrCPEC~KVFsCPANLASHRRWHKPR~eaa~a~~~P~k~~~~~rae~~e 344 (500)
T KOG3993|consen 267 DYICQL--CKEKYEDAFALAQHRCPRIVHVEYRCPECDKVFSCPANLASHRRWHKPRPEAAKAGSPPPKQAVETRAEVQE 344 (500)
T ss_pred HHHHHH--HHHhhhhHHHHhhccCCeeEEeeecCCcccccccCchhhhhhhcccCCchhhhhcCCCChhhhhhhhhhhhh
Confidence 388888 8888888888888853 23778888888888888888888774221100 000000000001111111
Q ss_pred HHhh--hCCCCceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1150 HIRV--HTGARPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1150 H~Ri--HTGEKPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
-.|. -..+--|.|.. |+|.|++..-|++|+-+|
T Consensus 345 a~rsg~dss~gi~~C~~--C~KkFrRqAYLrKHqlth 379 (500)
T KOG3993|consen 345 AERSGDDSSSGIFSCHT--CGKKFRRQAYLRKHQLTH 379 (500)
T ss_pred ccccCCcccCceeecHH--hhhhhHHHHHHHHhHHhh
Confidence 1110 01223699988 999999999999999996
No 20
>PF13465 zf-H2C2_2: Zinc-finger double domain; PDB: 2EN7_A 1TF6_A 1TF3_A 2ELT_A 2EOS_A 2EN2_A 2DMD_A 2WBS_A 2WBU_A 2EM5_A ....
Probab=97.09 E-value=0.0002 Score=53.36 Aligned_cols=26 Identities=35% Similarity=0.680 Sum_probs=23.3
Q ss_pred HHHhhhhhccCCCCCCCCCCCCCccccC
Q 001000 1116 YLVQHRRVHLDDRPLKCPWKGCKMTFKW 1143 (1193)
Q Consensus 1116 sLq~HqRvHtGEKPykCp~~eCGKtFs~ 1143 (1193)
.|..|+++|++++||.| +.|++.|.+
T Consensus 1 ~l~~H~~~H~~~k~~~C--~~C~k~F~~ 26 (26)
T PF13465_consen 1 NLRRHMRTHTGEKPYKC--PYCGKSFSN 26 (26)
T ss_dssp HHHHHHHHHSSSSSEEE--SSSSEEESS
T ss_pred CHHHHhhhcCCCCCCCC--CCCcCeeCc
Confidence 48899999999999999 669999964
No 21
>PHA00616 hypothetical protein
Probab=96.84 E-value=0.00055 Score=57.41 Aligned_cols=34 Identities=15% Similarity=0.145 Sum_probs=29.1
Q ss_pred CCCCCCCCCCccccChHHHHHHHhhhCCCCceecCC
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAE 1164 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~e 1164 (1193)
||.| ..||+.|...+.|..|++.|+|++||.|+.
T Consensus 1 pYqC--~~CG~~F~~~s~l~~H~r~~hg~~~~~~~~ 34 (44)
T PHA00616 1 MYQC--LRCGGIFRKKKEVIEHLLSVHKQNKLTLEY 34 (44)
T ss_pred CCcc--chhhHHHhhHHHHHHHHHHhcCCCccceeE
Confidence 6888 669999999999999999999999888864
No 22
>PHA00732 hypothetical protein
Probab=96.77 E-value=0.001 Score=62.13 Aligned_cols=20 Identities=30% Similarity=0.273 Sum_probs=10.0
Q ss_pred CcCCCCCcccChhHHHhhhh
Q 001000 1103 PVKGCGKKFFSHKYLVQHRR 1122 (1193)
Q Consensus 1103 pCe~CgKsFsskssLq~HqR 1122 (1193)
.|..|++.|.....|..|++
T Consensus 3 ~C~~Cgk~F~s~s~Lk~H~r 22 (79)
T PHA00732 3 KCPICGFTTVTLFALKQHAR 22 (79)
T ss_pred cCCCCCCccCCHHHHHHHhh
Confidence 44445555555555555544
No 23
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=96.13 E-value=0.0022 Score=72.48 Aligned_cols=25 Identities=20% Similarity=0.752 Sum_probs=22.0
Q ss_pred CCCceecCCCCcCCcccChhhHHHhhh
Q 001000 1156 GARPYVCAEPGCGQTFRFVSDFSRHKR 1182 (1193)
Q Consensus 1156 GEKPYkC~epGCGKsFs~sSsL~rH~R 1182 (1193)
..|||.|+. |+|.|++...|+-|..
T Consensus 395 ~~KPYrCev--C~KRYKNlNGLKYHr~ 419 (423)
T COG5189 395 KDKPYRCEV--CDKRYKNLNGLKYHRK 419 (423)
T ss_pred cCCceeccc--cchhhccCccceeccc
Confidence 358999988 9999999999988865
No 24
>PHA00732 hypothetical protein
Probab=96.04 E-value=0.0051 Score=57.54 Aligned_cols=45 Identities=29% Similarity=0.526 Sum_probs=33.9
Q ss_pred CCCCCCCCCCccccChHHHHHHHhh-hCCCCceecCCCCcCCcccChhhHHHhhhh
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRV-HTGARPYVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~Ri-HTGEKPYkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
||.| ..||+.|.....|..|++. |+ ++.|+. ||+.|. .|..|.++
T Consensus 1 py~C--~~Cgk~F~s~s~Lk~H~r~~H~---~~~C~~--CgKsF~---~l~~H~~~ 46 (79)
T PHA00732 1 MFKC--PICGFTTVTLFALKQHARRNHT---LTKCPV--CNKSYR---RLNQHFYS 46 (79)
T ss_pred CccC--CCCCCccCCHHHHHHHhhcccC---CCccCC--CCCEeC---Chhhhhcc
Confidence 5778 6688888888888888874 65 357877 888886 47777765
No 25
>PHA00616 hypothetical protein
Probab=96.02 E-value=0.0027 Score=53.41 Aligned_cols=30 Identities=23% Similarity=0.431 Sum_probs=25.8
Q ss_pred ceecCCCCcCCcccChhhHHHhhhhhcCCCCCCC
Q 001000 1159 PYVCAEPGCGQTFRFVSDFSRHKRKTGHSAKKSR 1192 (1193)
Q Consensus 1159 PYkC~epGCGKsFs~sSsL~rH~Rth~HsgeK~~ 1192 (1193)
||+|.. ||+.|.+.+.|.+|+++ |.|++++
T Consensus 1 pYqC~~--CG~~F~~~s~l~~H~r~--~hg~~~~ 30 (44)
T PHA00616 1 MYQCLR--CGGIFRKKKEVIEHLLS--VHKQNKL 30 (44)
T ss_pred CCccch--hhHHHhhHHHHHHHHHH--hcCCCcc
Confidence 799988 99999999999999999 5555553
No 26
>COG5189 SFP1 Putative transcriptional repressor regulating G2/M transition [Transcription / Cell division and chromosome partitioning]
Probab=95.97 E-value=0.002 Score=72.83 Aligned_cols=72 Identities=19% Similarity=0.393 Sum_probs=51.4
Q ss_pred CCccccCCCCCCCcccChhHHhhhhcc-ccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHh
Q 001000 1074 EAGYHCDMEGCTMSFGTKQELVLHKKN-ICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIR 1152 (1193)
Q Consensus 1074 EKpyqCdiegCGKsFssks~Lk~Hkr~-hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~R 1152 (1193)
++||+|++++|.|.|.....|+.|+.. || .........-..|.-.-...|||.| +.|+|+|..-..|+.|..
T Consensus 347 ~KpykCpV~gC~K~YknqnGLKYH~lhGH~-----~~~~~~~p~p~~~~~F~~~~KPYrC--evC~KRYKNlNGLKYHr~ 419 (423)
T COG5189 347 GKPYKCPVEGCNKKYKNQNGLKYHMLHGHQ-----NQKLHENPSPEKMNIFSAKDKPYRC--EVCDKRYKNLNGLKYHRK 419 (423)
T ss_pred CceecCCCCCchhhhccccchhhhhhcccc-----CcccCCCCCccccccccccCCceec--cccchhhccCccceeccc
Confidence 599999999999999999999999874 32 1111111111112222446799999 669999999999999854
No 27
>PF12756 zf-C2H2_2: C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=95.62 E-value=0.0083 Score=55.64 Aligned_cols=76 Identities=24% Similarity=0.312 Sum_probs=21.6
Q ss_pred cCCCCCcccChhHHHhhhhh-ccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhh
Q 001000 1104 VKGCGKKFFSHKYLVQHRRV-HLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKR 1182 (1193)
Q Consensus 1104 Ce~CgKsFsskssLq~HqRv-HtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~R 1182 (1193)
|..|+..|.....|..|+.. |.-..+ ....+.....+..+.+.-. ..+|.|.. |++.|.....|..|++
T Consensus 2 C~~C~~~f~~~~~l~~H~~~~H~~~~~-------~~~~l~~~~~~~~~~~~~~-~~~~~C~~--C~~~f~s~~~l~~Hm~ 71 (100)
T PF12756_consen 2 CLFCDESFSSVDDLLQHMKKKHGFDIP-------DQKYLVDPNRLLNYLRKKV-KESFRCPY--CNKTFRSREALQEHMR 71 (100)
T ss_dssp -------------------------------------------------------SSEEBSS--SS-EESSHHHHHHHHH
T ss_pred ccccccccccccccccccccccccccc-------ccccccccccccccccccc-CCCCCCCc--cCCCCcCHHHHHHHHc
Confidence 55677777777777777654 322211 0111223333334433221 22688877 8888888888888888
Q ss_pred hhcCCCC
Q 001000 1183 KTGHSAK 1189 (1193)
Q Consensus 1183 th~Hsge 1189 (1193)
.++|...
T Consensus 72 ~~~H~~~ 78 (100)
T PF12756_consen 72 SKHHKKR 78 (100)
T ss_dssp HTTTTC-
T ss_pred CccCCCc
Confidence 7777653
No 28
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=95.39 E-value=0.0092 Score=67.11 Aligned_cols=137 Identities=21% Similarity=0.260 Sum_probs=88.9
Q ss_pred CccccccCCcccccCcccccccc--cccCC--CccccCCCCCCCcccChhHHhhhhccc-------cCcCCCCCcccChh
Q 001000 1047 PAAKKKVKNASVVKAPAGLNNAK--IKDEE--AGYHCDMEGCTMSFGTKQELVLHKKNI-------CPVKGCGKKFFSHK 1115 (1193)
Q Consensus 1047 ~k~kC~iC~k~f~kk~~L~~H~r--iHtgE--KpyqCdiegCGKsFssks~Lk~Hkr~h-------CpCe~CgKsFssks 1115 (1193)
....|..|...|.....+..|.+ .|.++ +++.|.+..|++.|.....+..|...+ +....|...+....
T Consensus 288 ~~~~~~~~~~~~s~~~~l~~~~~~~~h~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 367 (467)
T COG5048 288 LPIKSKQCNISFSRSSPLTRHLRSVNHSGESLKPFSCPYSLCGKLFSRNDALKRHILLHTSISPAKEKLLNSSSKFSPLL 367 (467)
T ss_pred cCCCCccccCCccccccccccccccccccccCCceeeeccCCCccccccccccCCcccccCCCccccccccCcccccccc
Confidence 46789999999999999999999 89999 999999445999999999999886643 22223444333322
Q ss_pred HHH-----hhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhh
Q 001000 1116 YLV-----QHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1116 sLq-----~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
.-. .+.........+.|....|-..+.....+..|...|....++.|..++|.+.|.....+..|++.
T Consensus 368 ~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 440 (467)
T COG5048 368 NNEPPQSLQQYKDLKNDKKSETLSNSCIRNFKRDSNLSLHIITHLSFRPYNCKNPPCSKSFNRHYNLIPHKKI 440 (467)
T ss_pred CCCCccchhhccCccCCccccccccchhhhhccccccccccccccccCCcCCCCCcchhhccCcccccccccc
Confidence 211 11111222334444444466666666666666666666665555555577777666666666665
No 29
>PF05605 zf-Di19: Drought induced 19 protein (Di19), zinc-binding; InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=95.04 E-value=0.03 Score=48.39 Aligned_cols=49 Identities=22% Similarity=0.489 Sum_probs=34.5
Q ss_pred CCCCCCCCCCccccChHHHHHHHhh-hCCC-CceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRV-HTGA-RPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~Ri-HTGE-KPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
.|.||| |++. .....|..|... |..+ +.+.|+. |...+. .+|..|+..+
T Consensus 2 ~f~CP~--C~~~-~~~~~L~~H~~~~H~~~~~~v~CPi--C~~~~~--~~l~~Hl~~~ 52 (54)
T PF05605_consen 2 SFTCPY--CGKG-FSESSLVEHCEDEHRSESKNVVCPI--CSSRVT--DNLIRHLNSQ 52 (54)
T ss_pred CcCCCC--CCCc-cCHHHHHHHHHhHCcCCCCCccCCC--chhhhh--hHHHHHHHHh
Confidence 478866 8884 445678888664 6554 5688877 888655 3888888874
No 30
>PF00096 zf-C2H2: Zinc finger, C2H2 type; InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=94.72 E-value=0.018 Score=40.96 Aligned_cols=22 Identities=41% Similarity=0.936 Sum_probs=16.4
Q ss_pred eecCCCCcCCcccChhhHHHhhhh
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
|+|+. |++.|.....|..|++.
T Consensus 1 y~C~~--C~~~f~~~~~l~~H~~~ 22 (23)
T PF00096_consen 1 YKCPI--CGKSFSSKSNLKRHMRR 22 (23)
T ss_dssp EEETT--TTEEESSHHHHHHHHHH
T ss_pred CCCCC--CCCccCCHHHHHHHHhH
Confidence 56766 77777777777777776
No 31
>PF13912 zf-C2H2_6: C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=93.66 E-value=0.042 Score=40.58 Aligned_cols=24 Identities=46% Similarity=0.989 Sum_probs=20.1
Q ss_pred ceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1159 PYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1159 PYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
||.|.. |++.|.....|..|++.|
T Consensus 1 ~~~C~~--C~~~F~~~~~l~~H~~~h 24 (27)
T PF13912_consen 1 PFECDE--CGKTFSSLSALREHKRSH 24 (27)
T ss_dssp SEEETT--TTEEESSHHHHHHHHCTT
T ss_pred CCCCCc--cCCccCChhHHHHHhHHh
Confidence 688888 888888888888888874
No 32
>PF13894 zf-C2H2_4: C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=93.31 E-value=0.061 Score=37.68 Aligned_cols=23 Identities=35% Similarity=0.844 Sum_probs=16.3
Q ss_pred eecCCCCcCCcccChhhHHHhhhhh
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
|.|+. |++.|.....|..|+++|
T Consensus 1 ~~C~~--C~~~~~~~~~l~~H~~~~ 23 (24)
T PF13894_consen 1 FQCPI--CGKSFRSKSELRQHMRTH 23 (24)
T ss_dssp EE-SS--TS-EESSHHHHHHHHHHH
T ss_pred CCCcC--CCCcCCcHHHHHHHHHhh
Confidence 67877 888888888888888775
No 33
>PF00096 zf-C2H2: Zinc finger, C2H2 type; InterPro: IPR007087 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. The C2H2 zinc finger is the classical zinc finger domain. The two conserved cysteines and histidines co-ordinate a zinc ion. The following pattern describes the zinc finger: #-X-C-X(1-5)-C-X3-#-X5-#-X2-H-X(3-6)-[H/C], where X can be any amino acid, and numbers in brackets indicate the number of residues. The positions marked # are those that are important for the stable fold of the zinc finger. The final position can be either his or cys. The C2H2 zinc finger is composed of two short beta strands followed by an alpha helix. The amino terminal part of the helix binds the major groove in DNA binding zinc fingers. The accepted consensus binding sequence for Sp1 is usually defined by the asymmetric hexanucleotide core GGGCGG but this sequence does not include, among others, the GAG (=CTC) repeat that constitutes a high-affinity site for Sp1 binding to the wt1 promoter []. This entry represents the classical C2H2 zinc finger domain. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; GO: 0008270 zinc ion binding, 0005622 intracellular; PDB: 2D9H_A 2EPC_A 1SP1_A 1VA3_A 2WBT_B 2ELR_A 2YTP_A 2YTT_A 1VA1_A 2ELO_A ....
Probab=93.22 E-value=0.04 Score=39.22 Aligned_cols=23 Identities=30% Similarity=0.514 Sum_probs=16.6
Q ss_pred CCCCCCCCCccccChHHHHHHHhhh
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
|.| ..|++.|.....|..|++.|
T Consensus 1 y~C--~~C~~~f~~~~~l~~H~~~H 23 (23)
T PF00096_consen 1 YKC--PICGKSFSSKSNLKRHMRRH 23 (23)
T ss_dssp EEE--TTTTEEESSHHHHHHHHHHH
T ss_pred CCC--CCCCCccCCHHHHHHHHhHC
Confidence 467 55777777777777777765
No 34
>PF05605 zf-Di19: Drought induced 19 protein (Di19), zinc-binding; InterPro: IPR008598 This entry consists of several drought induced 19 (Di19) like and RING finger 114 proteins. Di19 has been found to be strongly expressed in both the roots and leaves of Arabidopsis thaliana during progressive drought [], whilst RING finger proteins are thought to play a role in spermatogenesis. The precise function is unknown.
Probab=92.26 E-value=0.22 Score=43.11 Aligned_cols=49 Identities=24% Similarity=0.407 Sum_probs=36.1
Q ss_pred cCcCCCCCcccChhHHHhhhhh-ccCC-CCCCCCCCCCCccccChHHHHHHHhhhC
Q 001000 1102 CPVKGCGKKFFSHKYLVQHRRV-HLDD-RPLKCPWKGCKMTFKWAWARTEHIRVHT 1155 (1193)
Q Consensus 1102 CpCe~CgKsFsskssLq~HqRv-HtGE-KPykCp~~eCGKtFs~kS~LkrH~RiHT 1155 (1193)
|.|+.|++. .....|..|... |..+ +.+.| +.|...+. .+|..|+..+.
T Consensus 3 f~CP~C~~~-~~~~~L~~H~~~~H~~~~~~v~C--PiC~~~~~--~~l~~Hl~~~H 53 (54)
T PF05605_consen 3 FTCPYCGKG-FSESSLVEHCEDEHRSESKNVVC--PICSSRVT--DNLIRHLNSQH 53 (54)
T ss_pred cCCCCCCCc-cCHHHHHHHHHhHCcCCCCCccC--CCchhhhh--hHHHHHHHHhc
Confidence 567779994 456789999664 7654 57999 56998655 48999998753
No 35
>PRK04860 hypothetical protein; Provisional
Probab=91.30 E-value=0.11 Score=54.70 Aligned_cols=39 Identities=36% Similarity=0.751 Sum_probs=34.0
Q ss_pred CCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccCh
Q 001000 1128 RPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFV 1174 (1193)
Q Consensus 1128 KPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~s 1174 (1193)
-+|.| . |++ ....+.+|.++|+++++|.|.. |++.|...
T Consensus 118 ~~Y~C--~-C~~---~~~~~rrH~ri~~g~~~YrC~~--C~~~l~~~ 156 (160)
T PRK04860 118 FPYRC--K-CQE---HQLTVRRHNRVVRGEAVYRCRR--CGETLVFK 156 (160)
T ss_pred EEEEc--C-CCC---eeCHHHHHHHHhcCCccEECCC--CCceeEEe
Confidence 47999 5 987 6778999999999999999988 99998764
No 36
>COG5048 FOG: Zn-finger [General function prediction only]
Probab=90.88 E-value=0.086 Score=59.40 Aligned_cols=75 Identities=25% Similarity=0.367 Sum_probs=53.4
Q ss_pred ccCcCCCCCcccChhHHHhhhh--hccCC--CCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChh
Q 001000 1101 ICPVKGCGKKFFSHKYLVQHRR--VHLDD--RPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVS 1175 (1193)
Q Consensus 1101 hCpCe~CgKsFsskssLq~HqR--vHtGE--KPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sS 1175 (1193)
.+.|..|...|.....|..|.+ .|+++ +|+.|++..|++.|.+...+..|..+|++.+++.|....|.+.+....
T Consensus 289 ~~~~~~~~~~~s~~~~l~~~~~~~~h~~~~~~~~~~p~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 367 (467)
T COG5048 289 PIKSKQCNISFSRSSPLTRHLRSVNHSGESLKPFSCPYSLCGKLFSRNDALKRHILLHTSISPAKEKLLNSSSKFSPLL 367 (467)
T ss_pred CCCCccccCCccccccccccccccccccccCCceeeeccCCCccccccccccCCcccccCCCccccccccCcccccccc
Confidence 4556677777777777777777 68877 788885335888888888888888888877777776545555554443
No 37
>PF12756 zf-C2H2_2: C2H2 type zinc-finger (2 copies); PDB: 2DMI_A.
Probab=90.50 E-value=0.15 Score=47.35 Aligned_cols=72 Identities=25% Similarity=0.391 Sum_probs=19.4
Q ss_pred ccCCCCCCCcccChhHHhhhhccccCcC-CCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhh
Q 001000 1078 HCDMEGCTMSFGTKQELVLHKKNICPVK-GCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1078 qCdiegCGKsFssks~Lk~Hkr~hCpCe-~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
+|.+ |+..|.....|..|+...+... .....+.....+..+.+.. -...+.| ..|++.|.....|..|++.+
T Consensus 1 ~C~~--C~~~f~~~~~l~~H~~~~H~~~~~~~~~l~~~~~~~~~~~~~-~~~~~~C--~~C~~~f~s~~~l~~Hm~~~ 73 (100)
T PF12756_consen 1 QCLF--CDESFSSVDDLLQHMKKKHGFDIPDQKYLVDPNRLLNYLRKK-VKESFRC--PYCNKTFRSREALQEHMRSK 73 (100)
T ss_dssp ---------------------------------------------------SSEEB--SSSS-EESSHHHHHHHHHHT
T ss_pred Cccc--cccccccccccccccccccccccccccccccccccccccccc-cCCCCCC--CccCCCCcCHHHHHHHHcCc
Confidence 3666 7777777777777765432211 1112222333333333221 1226889 55999999999999999864
No 38
>PF13912 zf-C2H2_6: C2H2-type zinc finger; PDB: 1JN7_A 1FU9_A 2L1O_A 1NJQ_A 2EN8_A 2EMM_A 1FV5_A 1Y0J_B 2L6Z_B.
Probab=88.84 E-value=0.19 Score=37.06 Aligned_cols=25 Identities=40% Similarity=0.660 Sum_probs=19.3
Q ss_pred CCCCCCCCCCccccChHHHHHHHhhhC
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRVHT 1155 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~RiHT 1155 (1193)
||.| ..|++.|.....|..|++.|.
T Consensus 1 ~~~C--~~C~~~F~~~~~l~~H~~~h~ 25 (27)
T PF13912_consen 1 PFEC--DECGKTFSSLSALREHKRSHC 25 (27)
T ss_dssp SEEE--TTTTEEESSHHHHHHHHCTTT
T ss_pred CCCC--CccCCccCChhHHHHHhHHhc
Confidence 5678 668888888888888887764
No 39
>smart00355 ZnF_C2H2 zinc finger.
Probab=88.69 E-value=0.3 Score=34.38 Aligned_cols=22 Identities=41% Similarity=0.905 Sum_probs=17.4
Q ss_pred eecCCCCcCCcccChhhHHHhhhh
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
|.|.. |++.|.....|..|++.
T Consensus 1 ~~C~~--C~~~f~~~~~l~~H~~~ 22 (26)
T smart00355 1 YRCPE--CGKVFKSKSALKEHMRT 22 (26)
T ss_pred CCCCC--CcchhCCHHHHHHHHHH
Confidence 56777 88888888888888875
No 40
>smart00355 ZnF_C2H2 zinc finger.
Probab=87.77 E-value=0.54 Score=33.05 Aligned_cols=24 Identities=38% Similarity=0.618 Sum_probs=17.9
Q ss_pred CCCCCCCCCccccChHHHHHHHhhhC
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRVHT 1155 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~RiHT 1155 (1193)
|.| ..|++.|.....|..|++.|.
T Consensus 1 ~~C--~~C~~~f~~~~~l~~H~~~H~ 24 (26)
T smart00355 1 YRC--PECGKVFKSKSALKEHMRTHX 24 (26)
T ss_pred CCC--CCCcchhCCHHHHHHHHHHhc
Confidence 567 558888888888888887664
No 41
>PF13894 zf-C2H2_4: C2H2-type zinc finger; PDB: 2ELX_A 2EPP_A 2DLK_A 1X6H_A 2EOU_A 2EMB_A 2GQJ_A 2CSH_A 2WBT_B 2ELM_A ....
Probab=87.53 E-value=0.35 Score=33.78 Aligned_cols=23 Identities=26% Similarity=0.603 Sum_probs=16.3
Q ss_pred CCCCCCCCCccccChHHHHHHHhhh
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
|.| ..|++.|.....|..|+++|
T Consensus 1 ~~C--~~C~~~~~~~~~l~~H~~~~ 23 (24)
T PF13894_consen 1 FQC--PICGKSFRSKSELRQHMRTH 23 (24)
T ss_dssp EE---SSTS-EESSHHHHHHHHHHH
T ss_pred CCC--cCCCCcCCcHHHHHHHHHhh
Confidence 567 55888888888888888765
No 42
>PF12874 zf-met: Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=83.01 E-value=0.52 Score=34.16 Aligned_cols=24 Identities=21% Similarity=0.582 Sum_probs=17.2
Q ss_pred eecCCCCcCCcccChhhHHHhhhhhc
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRKTG 1185 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rth~ 1185 (1193)
|.|.. |++.|.....|..|++.+.
T Consensus 1 ~~C~~--C~~~f~s~~~~~~H~~s~~ 24 (25)
T PF12874_consen 1 FYCDI--CNKSFSSENSLRQHLRSKK 24 (25)
T ss_dssp EEETT--TTEEESSHHHHHHHHTTHH
T ss_pred CCCCC--CCCCcCCHHHHHHHHCcCC
Confidence 56766 7777777777777777643
No 43
>PF09237 GAGA: GAGA factor; InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence []. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=82.03 E-value=0.83 Score=40.03 Aligned_cols=26 Identities=27% Similarity=0.604 Sum_probs=12.1
Q ss_pred CCCceecCCCCcCCcccChhhHHHhhhh
Q 001000 1156 GARPYVCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1156 GEKPYkC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
.+.|..|++ |+..+.+..+|.+|+..
T Consensus 21 S~~PatCP~--C~a~~~~srnLrRHle~ 46 (54)
T PF09237_consen 21 SEQPATCPI--CGAVIRQSRNLRRHLEI 46 (54)
T ss_dssp TS--EE-TT--T--EESSHHHHHHHHHH
T ss_pred cCCCCCCCc--chhhccchhhHHHHHHH
Confidence 345566644 66666666666666554
No 44
>PRK04860 hypothetical protein; Provisional
Probab=81.74 E-value=0.71 Score=48.78 Aligned_cols=39 Identities=21% Similarity=0.403 Sum_probs=32.0
Q ss_pred cccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccCh
Q 001000 1100 NICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWA 1144 (1193)
Q Consensus 1100 ~hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~k 1144 (1193)
++|.|. |+. ....+.+|.++|+++++|.| ..|+..|...
T Consensus 118 ~~Y~C~-C~~---~~~~~rrH~ri~~g~~~YrC--~~C~~~l~~~ 156 (160)
T PRK04860 118 FPYRCK-CQE---HQLTVRRHNRVVRGEAVYRC--RRCGETLVFK 156 (160)
T ss_pred EEEEcC-CCC---eeCHHHHHHHHhcCCccEEC--CCCCceeEEe
Confidence 456675 877 56678999999999999999 6799988754
No 45
>PF12171 zf-C2H2_jaz: Zinc-finger double-stranded RNA-binding; InterPro: IPR022755 This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation. This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=75.41 E-value=1 Score=33.64 Aligned_cols=25 Identities=20% Similarity=0.618 Sum_probs=18.7
Q ss_pred eecCCCCcCCcccChhhHHHhhhhhcC
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRKTGH 1186 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rth~H 1186 (1193)
|-|.. |++.|.....|..|+++..|
T Consensus 2 ~~C~~--C~k~f~~~~~~~~H~~sk~H 26 (27)
T PF12171_consen 2 FYCDA--CDKYFSSENQLKQHMKSKKH 26 (27)
T ss_dssp CBBTT--TTBBBSSHHHHHCCTTSHHH
T ss_pred CCccc--CCCCcCCHHHHHHHHccCCC
Confidence 66877 88888888888888776443
No 46
>PF09237 GAGA: GAGA factor; InterPro: IPR015318 Zinc finger (Znf) domains are relatively small protein motifs which contain multiple finger-like protrusions that make tandem contacts with their target molecule. Some of these domains bind zinc, but many do not; instead binding other metals such as iron, or no metal at all. For example, some family members form salt bridges to stabilise the finger-like folds. They were first identified as a DNA-binding motif in transcription factor TFIIIA from Xenopus laevis (African clawed frog), however they are now recognised to bind DNA, RNA, protein and/or lipid substrates [, , , , ]. Their binding properties depend on the amino acid sequence of the finger domains and of the linker between fingers, as well as on the higher-order structures and the number of fingers. Znf domains are often found in clusters, where fingers can have different binding specificities. There are many superfamilies of Znf motifs, varying in both sequence and structure. They display considerable versatility in binding modes, even between members of the same class (e.g. some bind DNA, others protein), suggesting that Znf motifs are stable scaffolds that have evolved specialised functions. For example, Znf-containing proteins function in gene transcription, translation, mRNA trafficking, cytoskeleton organisation, epithelial development, cell adhesion, protein folding, chromatin remodelling and zinc sensing, to name but a few []. Zinc-binding motifs are stable structures, and they rarely undergo conformational changes upon binding their target. Members of this entry bind to a 5'-GAGAG-3' DNA consensus binding site, and contain a Cys2-His2 zinc finger core as well as an N-terminal extension containing two highly basic regions. The zinc finger core binds in the DNA major groove and recognises the first three GAG bases of the consensus in a manner similar to that seen in other classical zinc finger-DNA complexes. The second basic region forms a helix that interacts in the major groove recognising the last G of the consensus, while the first basic region wraps around the DNA in the minor groove and recognises the A in the fourth position of the consensus sequence []. More information about these proteins can be found at Protein of the Month: Zinc Fingers [].; PDB: 1YUI_A 1YUJ_A.
Probab=75.35 E-value=2 Score=37.70 Aligned_cols=40 Identities=13% Similarity=0.367 Sum_probs=25.2
Q ss_pred Hhhhhh-ccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCc
Q 001000 1118 VQHRRV-HLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARP 1159 (1193)
Q Consensus 1118 q~HqRv-HtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKP 1159 (1193)
..+.+. +..+.|..| ++|+..+.+.-+|.+|+.++.+.||
T Consensus 12 ~~~~k~~~~S~~PatC--P~C~a~~~~srnLrRHle~~H~~k~ 52 (54)
T PF09237_consen 12 TKKPKSKSQSEQPATC--PICGAVIRQSRNLRRHLEIRHFKKP 52 (54)
T ss_dssp ----CCCCTTS--EE---TTT--EESSHHHHHHHHHHHTTTS-
T ss_pred hhHHHHhhccCCCCCC--CcchhhccchhhHHHHHHHHhcccC
Confidence 444443 456788999 6699999999999999998888876
No 47
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=74.02 E-value=3.6 Score=51.98 Aligned_cols=120 Identities=18% Similarity=0.171 Sum_probs=68.7
Q ss_pred ccccCCcccccCcccccccc-cccCCCccccCCCC--------CCCcccChhHHhhhhcc----------ccCcCCCCCc
Q 001000 1050 KKKVKNASVVKAPAGLNNAK-IKDEEAGYHCDMEG--------CTMSFGTKQELVLHKKN----------ICPVKGCGKK 1110 (1193)
Q Consensus 1050 kC~iC~k~f~kk~~L~~H~r-iHtgEKpyqCdieg--------CGKsFssks~Lk~Hkr~----------hCpCe~CgKs 1110 (1193)
.|..| ..|.....|..|+. .|. .+-|.+-- |.+. .+...|..|+.. |-.|..|...
T Consensus 117 ~~~~c-~~~~s~~~Lk~H~~~~H~---~~~c~lC~~~~kif~~e~k~-Yt~~el~~h~~~gd~d~~s~rGhp~C~~C~~~ 191 (669)
T KOG2231|consen 117 ECLHC-TEFKSVENLKNHMRDQHK---LHLCSLCLQNLKIFINERKL-YTRAELNLHLMFGDPDDESCRGHPLCKFCHER 191 (669)
T ss_pred CCccc-cchhHHHHHHHHHHHhhh---hhccccccccceeeeeeeeh-ehHHHHHHHHhcCCCccccccCCccchhhhhh
Confidence 45555 55556677777873 443 23333200 2222 356677777653 2347778889
Q ss_pred ccChhHHHhhhhhccCCCCCCCCC----CCCCccccChHHHHHHHhhhCCCCceecCCCCcC-CcccChhhHHHhhh
Q 001000 1111 FFSHKYLVQHRRVHLDDRPLKCPW----KGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCG-QTFRFVSDFSRHKR 1182 (1193)
Q Consensus 1111 FsskssLq~HqRvHtGEKPykCp~----~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCG-KsFs~sSsL~rH~R 1182 (1193)
|.....|..|++.++ |.|.+ ..++..|.....|..|-|.+ -|.|...-|- +.|.....+..|++
T Consensus 192 fld~~el~rH~~~~h----~~chfC~~~~~~neyy~~~~dLe~HfR~~----HflCE~~~C~~~~f~~~~~~ei~lk 260 (669)
T KOG2231|consen 192 FLDDDELYRHLRFDH----EFCHFCDYKTGQNEYYNDYDDLEEHFRKG----HFLCEEEFCRTKKFYVAFELEIELK 260 (669)
T ss_pred hccHHHHHHhhccce----eheeecCcccccchhcccchHHHHHhhhc----CccccccccccceeeehhHHHHHHH
Confidence 998888998888644 23422 12446677778888888764 3777632254 34444333333333
No 48
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=69.49 E-value=1.9 Score=57.39 Aligned_cols=91 Identities=19% Similarity=0.282 Sum_probs=52.2
Q ss_pred CCCcccChhHHhhhhc------cccCcCCCCCcccChhHHHhhhhh-ccCCCCCCCCCCCCCccccChHHHHHHHhh---
Q 001000 1084 CTMSFGTKQELVLHKK------NICPVKGCGKKFFSHKYLVQHRRV-HLDDRPLKCPWKGCKMTFKWAWARTEHIRV--- 1153 (1193)
Q Consensus 1084 CGKsFssks~Lk~Hkr------~hCpCe~CgKsFsskssLq~HqRv-HtGEKPykCp~~eCGKtFs~kS~LkrH~Ri--- 1153 (1193)
|+..|.....+.-|.. ..+.|+.|+..|.....|-.|+|+ |..-.--.|.+ ...|.+.
T Consensus 442 ~e~~~~s~r~~~~~t~~L~S~~kt~~cpkc~~~yk~a~~L~vhmRskhp~~~~~~c~~------------gq~~~~~arg 509 (1406)
T KOG1146|consen 442 AEPLLESKRSLEGQTVVLHSFFKTLKCPKCNWHYKLAQTLGVHMRSKHPESQSAYCKA------------GQNHPRLARG 509 (1406)
T ss_pred hhhhhhhhcccccceeeeecccccccCCccchhhhhHHHhhhcccccccccchhHhHh------------cccccccccc
Confidence 4445555444444422 235666666666666666666664 32221112211 1111111
Q ss_pred ---hCCCCceecCCCCcCCcccChhhHHHhhhhhcCCC
Q 001000 1154 ---HTGARPYVCAEPGCGQTFRFVSDFSRHKRKTGHSA 1188 (1193)
Q Consensus 1154 ---HTGEKPYkC~epGCGKsFs~sSsL~rH~Rth~Hsg 1188 (1193)
-.+.+||.|.. |..+|....+|.+|+...-|..
T Consensus 510 ~~~~~~~~p~~C~~--C~~stttng~LsihlqS~~h~~ 545 (1406)
T KOG1146|consen 510 EVYRCPGKPYPCRA--CNYSTTTNGNLSIHLQSDLHRN 545 (1406)
T ss_pred ccccCCCCccccee--eeeeeecchHHHHHHHHHhhHH
Confidence 12457899988 9999999999999998755543
No 49
>KOG1146 consensus Homeobox protein [General function prediction only]
Probab=68.61 E-value=1.3 Score=58.76 Aligned_cols=94 Identities=14% Similarity=0.116 Sum_probs=57.9
Q ss_pred cccCCCCCCCcccChhHHhhhhc--cccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHhhh
Q 001000 1077 YHCDMEGCTMSFGTKQELVLHKK--NICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1077 yqCdiegCGKsFssks~Lk~Hkr--~hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
+.|.. |.+.|.-...+. |.- .+|.|..|...|.....|..|++ + |-+.|.....+.-|+-.|
T Consensus 1261 ~~c~~--~~~~~~~~~~~~-~l~~~~~~~~~~~~~~~~~~~~l~~~~~--------k-----~~~~~~~~~~~~~~~l~~ 1324 (1406)
T KOG1146|consen 1261 GECGA--VDELLTPSFGIS-TLDVTHRYLCRQCKMAFDGEAPLTAHQR--------K-----FCFAGRGSGGSMPPPLRV 1324 (1406)
T ss_pred chhhh--ccccccCcccee-ecccchhHHHHHHHhhhcchhHHHHHHH--------H-----HHhccCccccCCCCcccC
Confidence 55655 666665555554 432 34666666666666666666651 1 223344444444455555
Q ss_pred CCCCceecCCCCcCCcccChhhHHHhhhhhcCCCC
Q 001000 1155 TGARPYVCAEPGCGQTFRFVSDFSRHKRKTGHSAK 1189 (1193)
Q Consensus 1155 TGEKPYkC~epGCGKsFs~sSsL~rH~Rth~Hsge 1189 (1193)
..-.+| |.. |...|.....|..|+|..+|..+
T Consensus 1325 ~d~~~~-c~~--c~~~~~~~~alqihm~~~~~~~k 1356 (1406)
T KOG1146|consen 1325 PDCTYH-CLA--CEVLLSGREALQIHMRSSAHRRK 1356 (1406)
T ss_pred cccccc-chH--HHhhcchhHHHHHHHHHhhhccc
Confidence 555667 887 88888888899999888666543
No 50
>PF12874 zf-met: Zinc-finger of C2H2 type; PDB: 1ZU1_A 2KVG_A.
Probab=61.89 E-value=3.7 Score=29.73 Aligned_cols=23 Identities=22% Similarity=0.486 Sum_probs=16.7
Q ss_pred CCCCCCCCCccccChHHHHHHHhhh
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
|.| ..|++.|.....|..|++.+
T Consensus 1 ~~C--~~C~~~f~s~~~~~~H~~s~ 23 (25)
T PF12874_consen 1 FYC--DICNKSFSSENSLRQHLRSK 23 (25)
T ss_dssp EEE--TTTTEEESSHHHHHHHHTTH
T ss_pred CCC--CCCCCCcCCHHHHHHHHCcC
Confidence 457 56888888888888887654
No 51
>PF13909 zf-H2C2_5: C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=61.29 E-value=5.5 Score=28.76 Aligned_cols=22 Identities=27% Similarity=0.699 Sum_probs=14.2
Q ss_pred eecCCCCcCCcccChhhHHHhhhhh
Q 001000 1160 YVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1160 YkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
|.|.. |..... ...|.+|++.+
T Consensus 1 y~C~~--C~y~t~-~~~l~~H~~~~ 22 (24)
T PF13909_consen 1 YKCPH--CSYSTS-KSNLKRHLKRH 22 (24)
T ss_dssp EE-SS--SS-EES-HHHHHHHHHHH
T ss_pred CCCCC--CCCcCC-HHHHHHHHHhh
Confidence 66766 777766 77777777764
No 52
>KOG2231 consensus Predicted E3 ubiquitin ligase [Posttranslational modification, protein turnover, chaperones]
Probab=60.23 E-value=9.1 Score=48.56 Aligned_cols=98 Identities=23% Similarity=0.341 Sum_probs=62.6
Q ss_pred ccCCCCCCCcccChhHHhhhhc-cc--cCcCCC---------CCcccChhHHHhhhhhc-cCCCC----CCCCCCCCCcc
Q 001000 1078 HCDMEGCTMSFGTKQELVLHKK-NI--CPVKGC---------GKKFFSHKYLVQHRRVH-LDDRP----LKCPWKGCKMT 1140 (1193)
Q Consensus 1078 qCdiegCGKsFssks~Lk~Hkr-~h--CpCe~C---------gKsFsskssLq~HqRvH-tGEKP----ykCp~~eCGKt 1140 (1193)
.|.+ | ..|.....|+.|+. .| +-|..| .........|..|++.- .+++. -.| .-|...
T Consensus 117 ~~~~--c-~~~~s~~~Lk~H~~~~H~~~~c~lC~~~~kif~~e~k~Yt~~el~~h~~~gd~d~~s~rGhp~C--~~C~~~ 191 (669)
T KOG2231|consen 117 ECLH--C-TEFKSVENLKNHMRDQHKLHLCSLCLQNLKIFINERKLYTRAELNLHLMFGDPDDESCRGHPLC--KFCHER 191 (669)
T ss_pred CCcc--c-cchhHHHHHHHHHHHhhhhhccccccccceeeeeeeehehHHHHHHHHhcCCCccccccCCccc--hhhhhh
Confidence 3544 5 55667888999975 22 223332 22233455677776641 12222 368 449999
Q ss_pred ccChHHHHHHHhhhCCCCceecCC----CCcCCcccChhhHHHhhhhh
Q 001000 1141 FKWAWARTEHIRVHTGARPYVCAE----PGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1141 Fs~kS~LkrH~RiHTGEKPYkC~e----pGCGKsFs~sSsL~rH~Rth 1184 (1193)
|.....|.+|++.+. |.|.+ +||+--|.....|..|-|.+
T Consensus 192 fld~~el~rH~~~~h----~~chfC~~~~~~neyy~~~~dLe~HfR~~ 235 (669)
T KOG2231|consen 192 FLDDDELYRHLRFDH----EFCHFCDYKTGQNEYYNDYDDLEEHFRKG 235 (669)
T ss_pred hccHHHHHHhhccce----eheeecCcccccchhcccchHHHHHhhhc
Confidence 999999999999753 55555 23345688889999999984
No 53
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=58.95 E-value=3.2 Score=46.34 Aligned_cols=37 Identities=32% Similarity=0.504 Sum_probs=18.3
Q ss_pred CCCcccChhHHhhhhc-cccCcCCCCCcccChhHHHhh
Q 001000 1084 CTMSFGTKQELVLHKK-NICPVKGCGKKFFSHKYLVQH 1120 (1193)
Q Consensus 1084 CGKsFssks~Lk~Hkr-~hCpCe~CgKsFsskssLq~H 1120 (1193)
|.+.|-...-|..|++ .||.|.+|.|.+.+--.|..|
T Consensus 16 cnrefddekiliqhqkakhfkchichkkl~sgpglsih 53 (341)
T KOG2893|consen 16 CNREFDDEKILIQHQKAKHFKCHICHKKLFSGPGLSIH 53 (341)
T ss_pred cccccchhhhhhhhhhhccceeeeehhhhccCCCceee
Confidence 5555555555555543 345555555544444444444
No 54
>KOG4377 consensus Zn-finger protein [General function prediction only]
Probab=58.34 E-value=4.8 Score=48.00 Aligned_cols=107 Identities=31% Similarity=0.540 Sum_probs=61.9
Q ss_pred CccccCCCCCCCcccChhHHhhhhc-------------------cccCcCCCCCcccChhHHHhhhhhccCC-------C
Q 001000 1075 AGYHCDMEGCTMSFGTKQELVLHKK-------------------NICPVKGCGKKFFSHKYLVQHRRVHLDD-------R 1128 (1193)
Q Consensus 1075 KpyqCdiegCGKsFssks~Lk~Hkr-------------------~hCpCe~CgKsFsskssLq~HqRvHtGE-------K 1128 (1193)
.-|.|.-+.|+..+..+..+..|.. ++|.-..|.+ .-+..+.|-..|+.. .
T Consensus 270 Ehyhcl~e~C~ykr~~k~DvirH~~~hkkrdnsL~dgf~rfs~syhC~~~~C~k---sTsdV~~h~nFht~~~n~Gfrrt 346 (480)
T KOG4377|consen 270 EHYHCLNEYCFYKRGQKNDVIRHVEIHKKRDNSLIDGFHRFSNSYHCTGQICEK---STSDVLLHDNFHTDKRNNGFRRT 346 (480)
T ss_pred hhhcccCccccccccchhhhHHHHHHHhhcccccccchhhcCccchhhhcccCc---ccccccccCccccccccCceecc
Confidence 3467766678777766666666622 1344456777 334556666666532 2
Q ss_pred CCCCCCCCCCccccChHHHHHHHhhhCCC------------------------CceecCCCCcCCcccChhhHHHhhhhh
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRVHTGA------------------------RPYVCAEPGCGQTFRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~RiHTGE------------------------KPYkC~epGCGKsFs~sSsL~rH~Rth 1184 (1193)
-|.|.-..|--+|.-..+-..|.+-+.++ .-|-|.++||+.+|...+.+..|.|.|
T Consensus 347 hfhC~r~gCTdtfK~~khk~yh~kdda~~~dGfkkf~k~e~cay~gCkys~~cnhfhc~r~Gc~~tl~s~sqm~shkrkh 426 (480)
T KOG4377|consen 347 HFHCQRIGCTDTFKDSKHKPYHYKDDAGEIDGFKKFFKDENCAYTGCKYSGICNHFHCDRLGCEATLYSVSQMASHKRKH 426 (480)
T ss_pred eeEEeccCCccccccccccccccCcchhhhhhhhhhhccccCCccCcccccceeeeeecccCCceEEEehhhhhhhhhhh
Confidence 35673222324444322222232222221 124588899999999999999999984
No 55
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=57.50 E-value=2.5 Score=46.33 Aligned_cols=81 Identities=22% Similarity=0.440 Sum_probs=57.6
Q ss_pred CccccCCCCCCCcccChhHHhhhhc--cccCcCCCCCcccChhHHHhhhhh-c---------cCCCCCCCCCCCCCcccc
Q 001000 1075 AGYHCDMEGCTMSFGTKQELVLHKK--NICPVKGCGKKFFSHKYLVQHRRV-H---------LDDRPLKCPWKGCKMTFK 1142 (1193)
Q Consensus 1075 KpyqCdiegCGKsFssks~Lk~Hkr--~hCpCe~CgKsFsskssLq~HqRv-H---------tGEKPykCp~~eCGKtFs 1142 (1193)
..|.|++.+|-..|........|-. .--.|..|.+.|.+...|-.|+.- | .|.--|.|-+.+|+-.|.
T Consensus 78 ~~~~cqvagc~~~~d~lD~~E~hY~~~h~~sCs~C~r~~Pt~hLLd~HI~E~HDs~Fqa~veRG~dMy~ClvEgCt~KFk 157 (253)
T KOG4173|consen 78 PAFACQVAGCCQVFDALDDYEHHYHTLHGNSCSFCKRAFPTGHLLDAHILEWHDSLFQALVERGQDMYQCLVEGCTEKFK 157 (253)
T ss_pred ccccccccchHHHHhhhhhHHHhhhhcccchhHHHHHhCCchhhhhHHHHHHHHHHHHHHHHcCccHHHHHHHhhhhhhh
Confidence 4588999899888877665555532 224688899999998888888753 3 344457787677888888
Q ss_pred ChHHHHHHHh-hhC
Q 001000 1143 WAWARTEHIR-VHT 1155 (1193)
Q Consensus 1143 ~kS~LkrH~R-iHT 1155 (1193)
+......|+- .|.
T Consensus 158 T~r~RkdH~I~~Hk 171 (253)
T KOG4173|consen 158 TSRDRKDHMIRMHK 171 (253)
T ss_pred hhhhhhhHHHHhcc
Confidence 8777777764 453
No 56
>KOG4124 consensus Putative transcriptional repressor regulating G2/M transition [Transcription; Cell cycle control, cell division, chromosome partitioning]
Probab=56.85 E-value=3.5 Score=48.21 Aligned_cols=105 Identities=16% Similarity=0.302 Sum_probs=0.0
Q ss_pred CCCccccCCCCCCCcccChhHHhhh----------hccccCcCCCCCcccChhHHHhh-hhhccCC--------------
Q 001000 1073 EEAGYHCDMEGCTMSFGTKQELVLH----------KKNICPVKGCGKKFFSHKYLVQH-RRVHLDD-------------- 1127 (1193)
Q Consensus 1073 gEKpyqCdiegCGKsFssks~Lk~H----------kr~hCpCe~CgKsFsskssLq~H-qRvHtGE-------------- 1127 (1193)
+|+++.|...+|.+.+........| -+.+|.|. |++.+.+...|+.| +..|-++
T Consensus 175 EE~~~S~~vp~~~~~~~~~Ns~~~~S~~~~~T~~t~~~p~k~~-~~~~~~T~~~l~~HS~N~~~~~Sa~n~~~~~Q~~~~ 253 (442)
T KOG4124|consen 175 EEYRVSVVVPAAAAAAAAANSSDMSSDEASSTAETTGTPKKMP-ESLVMDTSSPLSDHSMNIDVGESAANNVFAFQQKDM 253 (442)
T ss_pred ccccccccCchhhhhhhccccccccccccccccccccCCccCc-ccccccccchhhhccccCCCCccHHHHHHHHhhccc
Q ss_pred --------------------------------------------------------------------------------
Q 001000 1128 -------------------------------------------------------------------------------- 1127 (1193)
Q Consensus 1128 -------------------------------------------------------------------------------- 1127 (1193)
T Consensus 254 ~~st~~~~~~~~h~~~~~~~~~~s~~~~~~s~~~ptp~v~~~a~~~s~~~~p~v~~~s~~~~~~~s~~~~s~~~~~~~~~ 333 (442)
T KOG4124|consen 254 VDSTYLPPFNYDHDVFSFAPSVASADQFTESSMSPTPEVVSPAATNSAISSPFVRKSSSDLEAKPSKKQRSTPAFSHDSP 333 (442)
T ss_pred ccccccCCcCccchhhhhhhhhhccccccccCCCCCcccccccccccccCCCceeeccCCcccCcchhccCcccccCCCc
Q ss_pred --------------CCCCCCCCCCCccccChHHHHHHHhh-h------------------CCCCceecCCCCcCCcccCh
Q 001000 1128 --------------RPLKCPWKGCKMTFKWAWARTEHIRV-H------------------TGARPYVCAEPGCGQTFRFV 1174 (1193)
Q Consensus 1128 --------------KPykCp~~eCGKtFs~kS~LkrH~Ri-H------------------TGEKPYkC~epGCGKsFs~s 1174 (1193)
+||.|+++.|.+.+.....|..|... | ...|||.|+. |.+.++..
T Consensus 334 ~~~~~~~~~~~~~~~~~~~~vp~~~~~~~n~ng~~~~~~~~h~s~i~~~s~~~~ph~~~~~~nk~~r~~i--~~~~~k~~ 411 (442)
T KOG4124|consen 334 LTIDYPGSNLVVVDKPYKCPVPNCDKAYKNQNGLKYHKLHGHCSPITTPTPAPIPHQGFVVENKPYRCEV--CSKRYKNL 411 (442)
T ss_pred eeeecCCCeEEEecCCCCCCCCcchhhcccCcceeeccccCcCCCCCCCCCCCCCcceeeeccCcccChh--hhhhhccC
Q ss_pred hhHHHh
Q 001000 1175 SDFSRH 1180 (1193)
Q Consensus 1175 SsL~rH 1180 (1193)
..|.-|
T Consensus 412 ~~l~~~ 417 (442)
T KOG4124|consen 412 NGLKYH 417 (442)
T ss_pred CCCCce
No 57
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=55.44 E-value=7 Score=30.29 Aligned_cols=26 Identities=23% Similarity=0.423 Sum_probs=19.6
Q ss_pred ceecCCCCcCCcccChhhHHHhhhhhcC
Q 001000 1159 PYVCAEPGCGQTFRFVSDFSRHKRKTGH 1186 (1193)
Q Consensus 1159 PYkC~epGCGKsFs~sSsL~rH~Rth~H 1186 (1193)
+|.|.. |++.|.....+..|+....|
T Consensus 3 ~~~C~~--C~~~~~~~~~~~~H~~gk~H 28 (35)
T smart00451 3 GFYCKL--CNVTFTDEISVEAHLKGKKH 28 (35)
T ss_pred CeEccc--cCCccCCHHHHHHHHChHHH
Confidence 577877 88888888888888776444
No 58
>PF12171 zf-C2H2_jaz: Zinc-finger double-stranded RNA-binding; InterPro: IPR022755 This zinc finger is found in archaea and eukaryotes, and is approximately 30 amino acids in length. The mammalian members of this group occur multiple times along the protein, joined by flexible linkers, and are referred to as JAZ - dsRNA-binding ZF protein - zinc-fingers. The JAZ proteins are expressed in all tissues tested and localise in the nucleus, particularly the nucleolus []. JAZ preferentially binds to double-stranded (ds) RNA or RNA/DNA hybrids rather than DNA. In addition to binding double-stranded RNA, these zinc-fingers are required for nucleolar localisation. This entry represents the multiple-adjacent-C2H2 zinc finger, JAZ. ; PDB: 4DGW_A 1ZR9_A.
Probab=48.06 E-value=6.6 Score=29.35 Aligned_cols=22 Identities=18% Similarity=0.469 Sum_probs=14.9
Q ss_pred CCCCCCCCCccccChHHHHHHHhh
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRV 1153 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~Ri 1153 (1193)
|.| ..|++.|.....|..|++.
T Consensus 2 ~~C--~~C~k~f~~~~~~~~H~~s 23 (27)
T PF12171_consen 2 FYC--DACDKYFSSENQLKQHMKS 23 (27)
T ss_dssp CBB--TTTTBBBSSHHHHHCCTTS
T ss_pred CCc--ccCCCCcCCHHHHHHHHcc
Confidence 566 5577777777777777653
No 59
>KOG4173 consensus Alpha-SNAP protein [Intracellular trafficking, secretion, and vesicular transport]
Probab=46.93 E-value=6.3 Score=43.34 Aligned_cols=79 Identities=27% Similarity=0.466 Sum_probs=62.3
Q ss_pred ccCcCCCCCcccChhHHHhhhhhccCCCCCCCCCCCCCccccChHHHHHHHh-hh---------CCCCceecCCCCcCCc
Q 001000 1101 ICPVKGCGKKFFSHKYLVQHRRVHLDDRPLKCPWKGCKMTFKWAWARTEHIR-VH---------TGARPYVCAEPGCGQT 1170 (1193)
Q Consensus 1101 hCpCe~CgKsFsskssLq~HqRvHtGEKPykCp~~eCGKtFs~kS~LkrH~R-iH---------TGEKPYkC~epGCGKs 1170 (1193)
.|+.-.|...|......-.|..+-++. .| ..|.+.|.+..-|..|+. .| .|.--|+|-..||+-.
T Consensus 81 ~cqvagc~~~~d~lD~~E~hY~~~h~~---sC--s~C~r~~Pt~hLLd~HI~E~HDs~Fqa~veRG~dMy~ClvEgCt~K 155 (253)
T KOG4173|consen 81 ACQVAGCCQVFDALDDYEHHYHTLHGN---SC--SFCKRAFPTGHLLDAHILEWHDSLFQALVERGQDMYQCLVEGCTEK 155 (253)
T ss_pred cccccchHHHHhhhhhHHHhhhhcccc---hh--HHHHHhCCchhhhhHHHHHHHHHHHHHHHHcCccHHHHHHHhhhhh
Confidence 466677889998888777887653333 79 669999999999999986 24 3555699998899999
Q ss_pred ccChhhHHHhhhhh
Q 001000 1171 FRFVSDFSRHKRKT 1184 (1193)
Q Consensus 1171 Fs~sSsL~rH~Rth 1184 (1193)
|.+......|+-..
T Consensus 156 FkT~r~RkdH~I~~ 169 (253)
T KOG4173|consen 156 FKTSRDRKDHMIRM 169 (253)
T ss_pred hhhhhhhhhHHHHh
Confidence 99999999997653
No 60
>PF13909 zf-H2C2_5: C2H2-type zinc-finger domain; PDB: 1X5W_A.
Probab=44.81 E-value=13 Score=26.88 Aligned_cols=22 Identities=23% Similarity=0.505 Sum_probs=14.2
Q ss_pred CCCCCCCCCccccChHHHHHHHhhh
Q 001000 1130 LKCPWKGCKMTFKWAWARTEHIRVH 1154 (1193)
Q Consensus 1130 ykCp~~eCGKtFs~kS~LkrH~RiH 1154 (1193)
|.| ..|..... ...|..|++.|
T Consensus 1 y~C--~~C~y~t~-~~~l~~H~~~~ 22 (24)
T PF13909_consen 1 YKC--PHCSYSTS-KSNLKRHLKRH 22 (24)
T ss_dssp EE---SSSS-EES-HHHHHHHHHHH
T ss_pred CCC--CCCCCcCC-HHHHHHHHHhh
Confidence 567 45887776 77888887764
No 61
>PF13913 zf-C2HC_2: zinc-finger of a C2HC-type
Probab=41.17 E-value=19 Score=26.97 Aligned_cols=20 Identities=25% Similarity=0.700 Sum_probs=12.2
Q ss_pred ecCCCCcCCcccChhhHHHhhhh
Q 001000 1161 VCAEPGCGQTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1161 kC~epGCGKsFs~sSsL~rH~Rt 1183 (1193)
.|+. ||+.| ....|.+|+..
T Consensus 4 ~C~~--CgR~F-~~~~l~~H~~~ 23 (25)
T PF13913_consen 4 PCPI--CGRKF-NPDRLEKHEKI 23 (25)
T ss_pred cCCC--CCCEE-CHHHHHHHHHh
Confidence 4655 77776 55566666654
No 62
>TIGR00622 ssl1 transcription factor ssl1. This family is based on the phylogenomic analysis of JA Eisen (1999, Ph.D. Thesis, Stanford University).
Probab=40.15 E-value=46 Score=33.76 Aligned_cols=21 Identities=14% Similarity=0.365 Sum_probs=13.0
Q ss_pred CccccCCCCCCCcccChhHHhhh
Q 001000 1075 AGYHCDMEGCTMSFGTKQELVLH 1097 (1193)
Q Consensus 1075 KpyqCdiegCGKsFssks~Lk~H 1097 (1193)
.|..|++ ||...-....|.+.
T Consensus 14 LP~~Cpi--CgLtLVss~HLARS 34 (112)
T TIGR00622 14 LPVECPI--CGLTLILSTHLARS 34 (112)
T ss_pred CCCcCCc--CCCEEeccchHHHh
Confidence 4666766 77776665555443
No 63
>KOG2893 consensus Zn finger protein [General function prediction only]
Probab=32.49 E-value=14 Score=41.41 Aligned_cols=38 Identities=21% Similarity=0.372 Sum_probs=19.6
Q ss_pred CCccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHh
Q 001000 1137 CKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRH 1180 (1193)
Q Consensus 1137 CGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH 1180 (1193)
|.+.|....-|.+|++ .|.|+|.+ |.|..-.-..|..|
T Consensus 16 cnrefddekiliqhqk----akhfkchi--chkkl~sgpglsih 53 (341)
T KOG2893|consen 16 CNREFDDEKILIQHQK----AKHFKCHI--CHKKLFSGPGLSIH 53 (341)
T ss_pred cccccchhhhhhhhhh----hccceeee--ehhhhccCCCceee
Confidence 5555555555555554 23355555 55554444444444
No 64
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=30.92 E-value=40 Score=39.80 Aligned_cols=29 Identities=24% Similarity=0.387 Sum_probs=15.1
Q ss_pred cCCCCCCCcccChhHHhhhhcc-ccCcCCCCC
Q 001000 1079 CDMEGCTMSFGTKQELVLHKKN-ICPVKGCGK 1109 (1193)
Q Consensus 1079 CdiegCGKsFssks~Lk~Hkr~-hCpCe~CgK 1109 (1193)
|.+ |..-|..-..|..|.+. |=.|.+|.+
T Consensus 223 C~F--C~~~FYdDDEL~~HcR~~HE~ChICD~ 252 (493)
T COG5236 223 CIF--CKIYFYDDDELRRHCRLRHEACHICDM 252 (493)
T ss_pred hhh--ccceecChHHHHHHHHhhhhhhhhhhc
Confidence 555 66666666666666542 333444443
No 65
>PF07800 DUF1644: Protein of unknown function (DUF1644); InterPro: IPR012866 This family consists of sequences found in a number of hypothetical plant proteins of unknown function. The region of interest contains nine highly conserved cysteine residues and is approximately 160 amino acids in length, which probably represent a zinc-binding domain.
Probab=30.12 E-value=1.5e+02 Score=31.92 Aligned_cols=59 Identities=24% Similarity=0.543 Sum_probs=40.0
Q ss_pred CCCCCCCCCCC-ccccChHHHHHHHhhhCCCCceecCCCCcCCcccChhhHHHhhhhhcCCCCCCC
Q 001000 1128 RPLKCPWKGCK-MTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFVSDFSRHKRKTGHSAKKSR 1192 (1193)
Q Consensus 1128 KPykCp~~eCG-KtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~sSsL~rH~Rth~HsgeK~~ 1192 (1193)
....||. |. ..+-| .+..-.|.+...|+-.|...+|... -+...|.+|.|. .|-..+|.
T Consensus 79 ~~L~CPL--CRG~V~GW--tvve~AR~~LN~K~RsC~~e~C~F~-GtY~eLrKHar~-~HP~~rP~ 138 (162)
T PF07800_consen 79 PELACPL--CRGEVKGW--TVVEPARRFLNAKKRSCSQESCSFS-GTYSELRKHARS-EHPSARPS 138 (162)
T ss_pred ccccCcc--ccCceece--EEchHHHHHhccCCccCcccccccc-cCHHHHHHHHHh-hCCCCCCc
Confidence 3468854 75 33333 2334467788899999988778754 456789999998 47666664
No 66
>COG5236 Uncharacterized conserved protein, contains RING Zn-finger [General function prediction only]
Probab=29.76 E-value=32 Score=40.63 Aligned_cols=109 Identities=22% Similarity=0.329 Sum_probs=70.7
Q ss_pred CcccccccccccCCCccccCCCCC---CCccc------ChhHHhhhhc---------cccCcCCCCCcccChhHHHhhhh
Q 001000 1061 APAGLNNAKIKDEEAGYHCDMEGC---TMSFG------TKQELVLHKK---------NICPVKGCGKKFFSHKYLVQHRR 1122 (1193)
Q Consensus 1061 k~~L~~H~riHtgEKpyqCdiegC---GKsFs------sks~Lk~Hkr---------~hCpCe~CgKsFsskssLq~HqR 1122 (1193)
...|..|.+..++ .+.|.+ | .+.|. +...|..|.. -|-.|..|.+.|.....|..|+|
T Consensus 166 ~k~lk~H~K~~H~--~~~C~~--C~~nKk~F~~E~~lF~~~~Lr~H~~~G~~e~GFKGHP~C~FC~~~FYdDDEL~~HcR 241 (493)
T COG5236 166 LKELKKHYKAQHG--FVLCSE--CIGNKKDFWNEIRLFRSSTLRDHKNGGLEEEGFKGHPLCIFCKIYFYDDDELRRHCR 241 (493)
T ss_pred HHHHHHHHHhhcC--cEEhHh--hhcCcccCccceeeeecccccccccCCccccCcCCCchhhhccceecChHHHHHHHH
Confidence 4456667765543 456655 5 23343 4567777743 24458889999999999999998
Q ss_pred hccCCCCCCCCCCCCCc-------cccChHHHHHHHhhhCCCCceecCCCCcC----CcccChhhHHHhhhh
Q 001000 1123 VHLDDRPLKCPWKGCKM-------TFKWAWARTEHIRVHTGARPYVCAEPGCG----QTFRFVSDFSRHKRK 1183 (1193)
Q Consensus 1123 vHtGEKPykCp~~eCGK-------tFs~kS~LkrH~RiHTGEKPYkC~epGCG----KsFs~sSsL~rH~Rt 1183 (1193)
..+ + .| -+|.+ -|..-..|-.|.+. -.|.|.+-.|- ..|.....|..|+-.
T Consensus 242 ~~H-E---~C--hICD~v~p~~~QYFK~Y~~Le~HF~~----~hy~ct~qtc~~~k~~vf~~~~el~~h~~~ 303 (493)
T COG5236 242 LRH-E---AC--HICDMVGPIRYQYFKSYEDLEAHFRN----AHYCCTFQTCRVGKCYVFPYHTELLEHLTR 303 (493)
T ss_pred hhh-h---hh--hhhhccCccchhhhhCHHHHHHHhhc----CceEEEEEEEecCcEEEeccHHHHHHHHHH
Confidence 632 2 45 34554 36666777777663 24777654443 358888899999765
No 67
>PF14597 Lactamase_B_5: Metallo-beta-lactamase superfamily; PDB: 2P97_B.
Probab=29.48 E-value=33 Score=37.67 Aligned_cols=39 Identities=28% Similarity=0.341 Sum_probs=29.2
Q ss_pred HHHHHHhhcccCCceEEEEecCChhHHHHHHHHHHHHhCCcc
Q 001000 345 AVEVEQQLRPIGGVDIFLLCHPDYPKMVAEAKLVAEELGIDS 386 (1193)
Q Consensus 345 a~e~~~~l~~~gg~~~~~~c~~~y~k~~~~a~~~a~e~~~~~ 386 (1193)
+.+.++.|+++||+.-|||.|.|- ++.|+.+|+..|++.
T Consensus 43 s~~~~~~l~a~ggv~~IvLTn~dH---vR~A~~ya~~~~a~i 81 (199)
T PF14597_consen 43 SAHDWKHLDALGGVAWIVLTNRDH---VRAAEDYAEQTGAKI 81 (199)
T ss_dssp -HHHHHHHHHTT--SEEE-SSGGG----TTHHHHHHHS--EE
T ss_pred cHHHHHHHHhcCCceEEEEeCChh---HhHHHHHHHHhCCee
Confidence 578899999999999999999997 467999999999875
No 68
>KOG4377 consensus Zn-finger protein [General function prediction only]
Probab=28.64 E-value=20 Score=43.12 Aligned_cols=101 Identities=18% Similarity=0.304 Sum_probs=61.9
Q ss_pred ccCCcccccCcccccccccccCC------------CccccCCCCCCCcccChhHHhhh------------hccccCcCCC
Q 001000 1052 KVKNASVVKAPAGLNNAKIKDEE------------AGYHCDMEGCTMSFGTKQELVLH------------KKNICPVKGC 1107 (1193)
Q Consensus 1052 ~iC~k~f~kk~~L~~H~riHtgE------------KpyqCdiegCGKsFssks~Lk~H------------kr~hCpCe~C 1107 (1193)
..|...+..+....+|..+|... ..|.|...+|.+ .-+....| .+.||.|.-|
T Consensus 277 e~C~ykr~~k~DvirH~~~hkkrdnsL~dgf~rfs~syhC~~~~C~k---sTsdV~~h~nFht~~~n~GfrrthfhC~r~ 353 (480)
T KOG4377|consen 277 EYCFYKRGQKNDVIRHVEIHKKRDNSLIDGFHRFSNSYHCTGQICEK---STSDVLLHDNFHTDKRNNGFRRTHFHCQRI 353 (480)
T ss_pred ccccccccchhhhHHHHHHHhhcccccccchhhcCccchhhhcccCc---ccccccccCccccccccCceecceeEEecc
Confidence 45777766677777887777542 226898888988 34445555 2246666656
Q ss_pred C--CcccChhHHHhhhhhccCC------------------------CCCCCCCCCCCccccChHHHHHHHhhhC
Q 001000 1108 G--KKFFSHKYLVQHRRVHLDD------------------------RPLKCPWKGCKMTFKWAWARTEHIRVHT 1155 (1193)
Q Consensus 1108 g--KsFsskssLq~HqRvHtGE------------------------KPykCp~~eCGKtFs~kS~LkrH~RiHT 1155 (1193)
+ -.|.....-..|.+-+.++ .-|.|-|.+|+.+|...+.+..|.|.|.
T Consensus 354 gCTdtfK~~khk~yh~kdda~~~dGfkkf~k~e~cay~gCkys~~cnhfhc~r~Gc~~tl~s~sqm~shkrkhe 427 (480)
T KOG4377|consen 354 GCTDTFKDSKHKPYHYKDDAGEIDGFKKFFKDENCAYTGCKYSGICNHFHCDRLGCEATLYSVSQMASHKRKHE 427 (480)
T ss_pred CCccccccccccccccCcchhhhhhhhhhhccccCCccCcccccceeeeeecccCCceEEEehhhhhhhhhhhh
Confidence 6 4444222222222222221 1145666889999999999999999884
No 69
>PF13913 zf-C2HC_2: zinc-finger of a C2HC-type
Probab=27.02 E-value=56 Score=24.57 Aligned_cols=19 Identities=21% Similarity=0.307 Sum_probs=11.6
Q ss_pred CCCCCCCCccccChHHHHHHHh
Q 001000 1131 KCPWKGCKMTFKWAWARTEHIR 1152 (1193)
Q Consensus 1131 kCp~~eCGKtFs~kS~LkrH~R 1152 (1193)
.| ..||+.| ....|..|+.
T Consensus 4 ~C--~~CgR~F-~~~~l~~H~~ 22 (25)
T PF13913_consen 4 PC--PICGRKF-NPDRLEKHEK 22 (25)
T ss_pred cC--CCCCCEE-CHHHHHHHHH
Confidence 56 4477777 5555666654
No 70
>smart00451 ZnF_U1 U1-like zinc finger. Family of C2H2-type zinc fingers, present in matrin, U1 small nuclear ribonucleoprotein C and other RNA-binding proteins.
Probab=26.46 E-value=43 Score=25.89 Aligned_cols=23 Identities=26% Similarity=0.469 Sum_probs=19.3
Q ss_pred CCCCCCCCCCccccChHHHHHHHhh
Q 001000 1129 PLKCPWKGCKMTFKWAWARTEHIRV 1153 (1193)
Q Consensus 1129 PykCp~~eCGKtFs~kS~LkrH~Ri 1153 (1193)
+|.| ..|++.|.....+..|+..
T Consensus 3 ~~~C--~~C~~~~~~~~~~~~H~~g 25 (35)
T smart00451 3 GFYC--KLCNVTFTDEISVEAHLKG 25 (35)
T ss_pred CeEc--cccCCccCCHHHHHHHHCh
Confidence 5789 6799999999999888864
No 71
>KOG2482 consensus Predicted C2H2-type Zn-finger protein [Transcription]
Probab=22.34 E-value=62 Score=38.36 Aligned_cols=104 Identities=21% Similarity=0.264 Sum_probs=0.0
Q ss_pred cccCCCCCCCcccChhHHhhhhcc--------------------------------------------------------
Q 001000 1077 YHCDMEGCTMSFGTKQELVLHKKN-------------------------------------------------------- 1100 (1193)
Q Consensus 1077 yqCdiegCGKsFssks~Lk~Hkr~-------------------------------------------------------- 1100 (1193)
+.|.+ |.+.|..+..|+.||+.
T Consensus 196 ~~CLy--CekifrdkntLkeHMrkK~HrrinPknreYDkfyiINY~ev~ks~t~~~~e~dret~~d~~E~D~~wsDw~ed 273 (423)
T KOG2482|consen 196 LRCLY--CEKIFRDKNTLKEHMRKKRHRRINPKNREYDKFYIINYLEVGKSWTIVHSEDDRETNEDINETDDTWSDWNED 273 (423)
T ss_pred heeee--eccccCCcHHHHHHHHhccCcccCCCccccceEEEEeHhhcCCccchhhhhhhhhhhccccccccchhhhhcC
Q ss_pred -----ccCcCCCCCcccChhHHHhhhh-hccCCCCCCCCCCCCCccccChHHHHHHHhhhCCCCceecCCCCcCCcccCh
Q 001000 1101 -----ICPVKGCGKKFFSHKYLVQHRR-VHLDDRPLKCPWKGCKMTFKWAWARTEHIRVHTGARPYVCAEPGCGQTFRFV 1174 (1193)
Q Consensus 1101 -----hCpCe~CgKsFsskssLq~HqR-vHtGEKPykCp~~eCGKtFs~kS~LkrH~RiHTGEKPYkC~epGCGKsFs~s 1174 (1193)
...|-.|....-+...|..||. +|.-.-.-.- ..-+--|.+.--+....|.. .+.-.|-. |.-.|-..
T Consensus 274 ~a~a~~v~CLfC~~~~en~~~l~eHmk~vHe~Dl~Ki~--sd~~Ln~YqrvrviNyiRkq--~~~~~c~~--cd~~F~~e 347 (423)
T KOG2482|consen 274 DAEALSVVCLFCTNFYENPVFLFEHMKIVHEFDLLKIQ--SDYSLNFYQRVRVINYIRKQ--KKKSRCAE--CDLSFWKE 347 (423)
T ss_pred CCCccceEEEeeccchhhHHHHHHHHHHHHHhhHHhhc--cccccchhhhhhHHHHHHHH--hhcccccc--ccccccCc
Q ss_pred hhHHHhhhhhcCCC
Q 001000 1175 SDFSRHKRKTGHSA 1188 (1193)
Q Consensus 1175 SsL~rH~Rth~Hsg 1188 (1193)
..|..||-.+.|.+
T Consensus 348 ~~l~~hm~e~k~l~ 361 (423)
T KOG2482|consen 348 PGLLIHMVEDKHLS 361 (423)
T ss_pred chhhhhcccccccc
No 72
>PF04273 DUF442: Putative phosphatase (DUF442); InterPro: IPR005939 Although this domain is uncharacterised it seems likely that it performs a phosphatase function.; GO: 0016787 hydrolase activity; PDB: 2F46_A 3GXH_B 3GXG_B.
Probab=21.58 E-value=96 Score=31.07 Aligned_cols=59 Identities=31% Similarity=0.321 Sum_probs=35.2
Q ss_pred HhhcccCCceEEEEecCC-----hhHHHHHHHHHHHHhCCccccCcchhcccChHhHHHHHhhhcc
Q 001000 350 QQLRPIGGVDIFLLCHPD-----YPKMVAEAKLVAEELGIDSLCDEISFRVATKEDEKRIHLSLDS 410 (1193)
Q Consensus 350 ~~l~~~gg~~~~~~c~~~-----y~k~~~~a~~~a~e~~~~~~w~~i~~~~a~~ed~~~i~~~~~~ 410 (1193)
++|...|=.+||-+. || -|.. ++-+..|+++|+.|-+--|.+...+.++...+..+|+.
T Consensus 21 ~~la~~GfktVInlR-pd~E~~~qp~~-~~~~~~a~~~Gl~y~~iPv~~~~~~~~~v~~f~~~l~~ 84 (110)
T PF04273_consen 21 AQLAAQGFKTVINLR-PDGEEPGQPSS-AEEAAAAEALGLQYVHIPVDGGAITEEDVEAFADALES 84 (110)
T ss_dssp HHHHHCT--EEEE-S--TTSTTT-T-H-HCHHHHHHHCT-EEEE----TTT--HHHHHHHHHHHHT
T ss_pred HHHHHCCCcEEEECC-CCCCCCCCCCH-HHHHHHHHHcCCeEEEeecCCCCCCHHHHHHHHHHHHh
Confidence 467777766666555 54 2332 23345789999999999999999999999999999985
Done!