Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | A7A17_RS18670 | Genome accession | NZ_CP076264 |
| Coordinates | 3766312..3767550 (-) | Length | 412 a.a. |
| NCBI ID | WP_257117329.1 | Uniprot ID | - |
| Organism | Escherichia coli strain NADC1036 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 3761312..3772550
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| A7A17_RS18650 (A7A17_18605) | dam | 3761924..3762760 (-) | 837 | WP_000742143.1 | adenine-specific DNA-methyltransferase | - |
| A7A17_RS18655 (A7A17_18610) | damX | 3762867..3764153 (-) | 1287 | WP_000343178.1 | cell division protein DamX | - |
| A7A17_RS18660 (A7A17_18615) | aroB | 3764245..3765333 (-) | 1089 | WP_000439846.1 | 3-dehydroquinate synthase | - |
| A7A17_RS18665 (A7A17_18620) | aroK | 3765390..3765911 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| A7A17_RS18670 (A7A17_18625) | comE | 3766312..3767550 (-) | 1239 | WP_257117329.1 | DNA uptake porin HofQ | Machinery gene |
| A7A17_RS18675 (A7A17_18630) | hofP | 3767462..3767866 (-) | 405 | WP_001264141.1 | DNA utilization protein HofP | - |
| A7A17_RS18680 (A7A17_18635) | hofO | 3767856..3768296 (-) | 441 | WP_001055760.1 | DNA utilization protein HofO | - |
| A7A17_RS18685 (A7A17_18640) | hofN | 3768280..3768819 (-) | 540 | WP_001069315.1 | DNA utilization protein HofN | - |
| A7A17_RS18690 (A7A17_18645) | hofM | 3768819..3769598 (-) | 780 | WP_001315880.1 | DNA utilization protein HofM | - |
| A7A17_RS18695 (A7A17_18650) | mrcA | 3769718..3772270 (+) | 2553 | WP_000673804.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44743.30 Da Isoelectric Point: 6.1173
>NTDB_id=501287 A7A17_RS18670 WP_257117329.1 3766312..3767550(-) (comE) [Escherichia coli strain NADC1036]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLALHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLALHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=501287 A7A17_RS18670 WP_257117329.1 3766312..3767550(-) (comE) [Escherichia coli strain NADC1036]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTGGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGGCTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCTATTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTTCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGTGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTTACATCTTCAGCCTGCCAGTATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTGGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGGCTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCTATTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTTCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGTGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTTACATCTTCAGCCTGCCAGTATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| comE | Haemophilus influenzae 86-028NP |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.952 |
100 |
0.367 |