Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | NMD37_RS01880 | Genome accession | NZ_CP100966 |
| Coordinates | 415977..417215 (+) | Length | 412 a.a. |
| NCBI ID | WP_137482110.1 | Uniprot ID | - |
| Organism | Escherichia coli strain ET350 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 410977..422215
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| NMD37_RS01855 (NMD37_01845) | mrcA | 411257..413809 (-) | 2553 | WP_001301905.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| NMD37_RS01860 (NMD37_01850) | hofM | 413929..414708 (+) | 780 | WP_001308095.1 | DNA utilization protein HofM | - |
| NMD37_RS01865 (NMD37_01855) | hofN | 414708..415247 (+) | 540 | WP_001069342.1 | DNA utilization protein HofN | - |
| NMD37_RS01870 (NMD37_01860) | hofO | 415231..415671 (+) | 441 | WP_001055738.1 | DNA utilization protein HofO | - |
| NMD37_RS01875 (NMD37_01865) | hofP | 415661..416065 (+) | 405 | WP_032218504.1 | DNA utilization protein HofP | - |
| NMD37_RS01880 (NMD37_01870) | comE | 415977..417215 (+) | 1239 | WP_137482110.1 | DNA uptake porin HofQ | Machinery gene |
| NMD37_RS01885 (NMD37_01875) | aroK | 417616..418137 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| NMD37_RS01890 (NMD37_01880) | aroB | 418194..419282 (+) | 1089 | WP_000439848.1 | 3-dehydroquinate synthase | - |
| NMD37_RS01895 (NMD37_01885) | damX | 419374..420660 (+) | 1287 | WP_000343210.1 | cell division protein DamX | - |
| NMD37_RS01900 (NMD37_01890) | dam | 420767..421603 (+) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44749.26 Da Isoelectric Point: 5.9488
>NTDB_id=607908 NMD37_RS01880 WP_137482110.1 415977..417215(+) (comE) [Escherichia coli strain ET350]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWLAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWLAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=607908 NMD37_RS01880 WP_137482110.1 415977..417215(+) (comE) [Escherichia coli strain ET350]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCACTTGAACAGTGGCTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGGGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATTCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATTGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCACTTGAACAGTGGCTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGGGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATTCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATTGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| comE | Haemophilus influenzae 86-028NP |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.714 |
100 |
0.364 |