Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | PY722_RS02340 | Genome accession | NZ_CP119006 |
| Coordinates | 454022..455260 (-) | Length | 412 a.a. |
| NCBI ID | WP_000815968.1 | Uniprot ID | - |
| Organism | Escherichia coli strain CE0021a | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 449022..460260
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| PY722_RS02320 (PY722_02320) | dam | 449634..450470 (-) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
| PY722_RS02325 (PY722_02325) | damX | 450577..451863 (-) | 1287 | WP_000343212.1 | cell division protein DamX | - |
| PY722_RS02330 (PY722_02330) | aroB | 451955..453043 (-) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| PY722_RS02335 (PY722_02335) | aroK | 453100..453621 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| PY722_RS02340 (PY722_02340) | comE | 454022..455260 (-) | 1239 | WP_000815968.1 | DNA uptake porin HofQ | Machinery gene |
| PY722_RS02345 (PY722_02345) | hofP | 455172..455576 (-) | 405 | WP_001264141.1 | DNA utilization protein HofP | - |
| PY722_RS02350 (PY722_02350) | hofO | 455566..456006 (-) | 441 | WP_001055757.1 | DNA utilization protein HofO | - |
| PY722_RS02355 (PY722_02355) | hofN | 455990..456529 (-) | 540 | WP_001052913.1 | DNA utilization protein HofN | - |
| PY722_RS02360 (PY722_02360) | hofM | 456529..457308 (-) | 780 | WP_001349954.1 | DNA utilization protein HofM | - |
| PY722_RS02365 (PY722_02365) | mrcA | 457428..459980 (+) | 2553 | WP_001300707.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44774.27 Da Isoelectric Point: 6.1173
>NTDB_id=724531 PY722_RS02340 WP_000815968.1 454022..455260(-) (comE) [Escherichia coli strain CE0021a]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEDNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEDNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=724531 PY722_RS02340 WP_000815968.1 454022..455260(-) (comE) [Escherichia coli strain CE0021a]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGACAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGACAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.385 |
100 |
0.396 |
| comE | Haemophilus influenzae 86-028NP |
37.156 |
100 |
0.393 |
| pilQ | Vibrio campbellii strain DS40M4 |
37.767 |
100 |
0.386 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.288 |
100 |
0.374 |
| pilQ | Vibrio cholerae strain A1552 |
37.288 |
100 |
0.374 |
| comE | Glaesserella parasuis strain SC1401 |
35.952 |
100 |
0.367 |