Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | EL041_RS02025 | Genome accession | NZ_LR134092 |
| Coordinates | 437776..439014 (+) | Length | 412 a.a. |
| NCBI ID | WP_000815965.1 | Uniprot ID | - |
| Organism | Escherichia coli strain NCTC10444 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 432776..444014
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| EL041_RS02000 (NCTC10444_00395) | mrcA | 433056..435608 (-) | 2553 | WP_001301905.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| EL041_RS02005 (NCTC10444_00396) | hofM | 435728..436507 (+) | 780 | WP_024257791.1 | DNA utilization protein HofM | - |
| EL041_RS02010 (NCTC10444_00397) | hofN | 436507..437046 (+) | 540 | WP_001069348.1 | DNA utilization protein HofN | - |
| EL041_RS02015 (NCTC10444_00398) | hofO | 437030..437470 (+) | 441 | WP_001055765.1 | DNA utilization protein HofO | - |
| EL041_RS02020 (NCTC10444_00399) | hofP | 437460..437864 (+) | 405 | WP_001264139.1 | DNA utilization protein HofP | - |
| EL041_RS02025 (NCTC10444_00400) | comE | 437776..439014 (+) | 1239 | WP_000815965.1 | DNA uptake porin HofQ | Machinery gene |
| EL041_RS02030 (NCTC10444_00401) | aroK | 439415..439936 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| EL041_RS02035 (NCTC10444_00402) | aroB | 439993..441081 (+) | 1089 | WP_000439848.1 | 3-dehydroquinate synthase | - |
| EL041_RS02040 (NCTC10444_00403) | damX | 441173..442459 (+) | 1287 | WP_000343210.1 | cell division protein DamX | - |
| EL041_RS02045 (NCTC10444_00404) | dam | 442566..443402 (+) | 837 | WP_000742147.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44735.24 Da Isoelectric Point: 5.9488
>NTDB_id=997527 EL041_RS02025 WP_000815965.1 437776..439014(+) (comE) [Escherichia coli strain NCTC10444]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTIVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTIVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=997527 EL041_RS02025 WP_000815965.1 437776..439014(+) (comE) [Escherichia coli strain NCTC10444]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTATAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTACCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCACTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAAGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCAGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTATAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTACCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCACTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAAGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCAGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae 86-028NP |
37.529 |
100 |
0.398 |
| comE | Haemophilus influenzae Rd KW20 |
37.385 |
100 |
0.396 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.48 |
100 |
0.393 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
38.015 |
100 |
0.381 |
| pilQ | Vibrio cholerae strain A1552 |
38.015 |
100 |
0.381 |
| comE | Glaesserella parasuis strain SC1401 |
35.714 |
100 |
0.364 |