Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | H1D09_RS18700 | Genome accession | NZ_LR778152 |
| Coordinates | 3883080..3884318 (+) | Length | 412 a.a. |
| NCBI ID | WP_000816002.1 | Uniprot ID | - |
| Organism | Escherichia coli isolate SC477 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 3878080..3889318
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| H1D09_RS18675 | mrcA | 3878360..3880912 (-) | 2553 | WP_001298208.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| H1D09_RS18680 | hofM | 3881032..3881811 (+) | 780 | WP_001296474.1 | DNA utilization protein HofM | - |
| H1D09_RS18685 | hofN | 3881811..3882350 (+) | 540 | WP_001069330.1 | DNA utilization protein HofN | - |
| H1D09_RS18690 | hofO | 3882334..3882774 (+) | 441 | WP_001356906.1 | DNA utilization protein HofO | - |
| H1D09_RS18695 | hofP | 3882764..3883168 (+) | 405 | WP_001356905.1 | DNA utilization protein HofP | - |
| H1D09_RS18700 | comE | 3883080..3884318 (+) | 1239 | WP_000816002.1 | DNA uptake porin HofQ | Machinery gene |
| H1D09_RS18705 | aroK | 3884719..3885240 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| H1D09_RS18710 | aroB | 3885297..3886385 (+) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| H1D09_RS18715 | damX | 3886477..3887763 (+) | 1287 | WP_000343172.1 | cell division protein DamX | - |
| H1D09_RS18720 | dam | 3887870..3888706 (+) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44700.19 Da Isoelectric Point: 6.1173
>NTDB_id=1008616 H1D09_RS18700 WP_000816002.1 3883080..3884318(+) (comE) [Escherichia coli isolate SC477]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQTRAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KAALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTALGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQTRAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KAALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTALGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=1008616 H1D09_RS18700 WP_000816002.1 3883080..3884318(+) (comE) [Escherichia coli isolate SC477]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTGGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTTTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATTTAACTGACGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGATTG
ATAACGCGCCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGACGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAGCGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGTGTGAAATGGACGCTGGCTGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCGCGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGTTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCAGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTGGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTTTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATTTAACTGACGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGATTG
ATAACGCGCCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGACGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAGCGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGTGTGAAATGGACGCTGGCTGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCGCGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGTTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCAGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.615 |
100 |
0.398 |
| comE | Haemophilus influenzae 86-028NP |
37.385 |
100 |
0.396 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.53 |
100 |
0.376 |
| pilQ | Vibrio cholerae strain A1552 |
37.53 |
100 |
0.376 |
| comE | Glaesserella parasuis strain SC1401 |
36.429 |
100 |
0.371 |
| pilQ | Pseudomonas aeruginosa PAK |
34.475 |
100 |
0.367 |