Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | NML25_RS21835 | Genome accession | NZ_CP101222 |
| Coordinates | 4509931..4511169 (-) | Length | 412 a.a. |
| NCBI ID | WP_072020699.1 | Uniprot ID | - |
| Organism | Escherichia coli strain EC21Z-144 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 4504931..4516169
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| NML25_RS21815 (NML25_21815) | dam | 4505542..4506378 (-) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
| NML25_RS21820 (NML25_21820) | damX | 4506485..4507771 (-) | 1287 | WP_001551753.1 | cell division protein DamX | - |
| NML25_RS21825 (NML25_21825) | aroB | 4507863..4508951 (-) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| NML25_RS21830 (NML25_21830) | aroK | 4509008..4509529 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| NML25_RS21835 (NML25_21835) | comE | 4509931..4511169 (-) | 1239 | WP_072020699.1 | DNA uptake porin HofQ | Machinery gene |
| NML25_RS21840 (NML25_21840) | hofP | 4511081..4511485 (-) | 405 | WP_001551755.1 | DNA utilization protein HofP | - |
| NML25_RS21845 (NML25_21845) | hofO | 4511475..4511915 (-) | 441 | WP_001551756.1 | DNA utilization protein HofO | - |
| NML25_RS21850 (NML25_21850) | hofN | 4511899..4512438 (-) | 540 | WP_001069326.1 | DNA utilization protein HofN | - |
| NML25_RS21855 (NML25_21855) | hofM | 4512438..4513217 (-) | 780 | WP_001551759.1 | DNA utilization protein HofM | - |
| NML25_RS21860 (NML25_21860) | mrcA | 4513337..4515889 (+) | 2553 | WP_001301905.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44722.24 Da Isoelectric Point: 5.9488
>NTDB_id=609281 NML25_RS21835 WP_072020699.1 4509931..4511169(-) (comE) [Escherichia coli strain EC21Z-144]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRSITLQYADVGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRSITLQYADVGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=609281 NML25_RS21835 WP_072020699.1 4509931..4511169(-) (comE) [Escherichia coli strain EC21Z-144]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACGCTGCAATACGCCGACGTGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGTTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACGCTGCAATACGCCGACGTGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGTTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae 86-028NP |
37.071 |
100 |
0.393 |
| comE | Haemophilus influenzae Rd KW20 |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.005 |
100 |
0.388 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.53 |
100 |
0.376 |
| pilQ | Vibrio cholerae strain A1552 |
37.53 |
100 |
0.376 |
| comE | Glaesserella parasuis strain SC1401 |
35.476 |
100 |
0.362 |