Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | P9060_RS01740 | Genome accession | NZ_CP121356 |
| Coordinates | 378557..379795 (+) | Length | 412 a.a. |
| NCBI ID | WP_000815986.1 | Uniprot ID | - |
| Organism | Escherichia coli strain rl0044 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 373557..384795
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| P9060_RS01715 (P9060_01715) | mrcA | 373837..376389 (-) | 2553 | WP_001300707.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| P9060_RS01720 (P9060_01720) | hofM | 376509..377288 (+) | 780 | Protein_340 | DNA utilization protein HofM | - |
| P9060_RS01725 (P9060_01725) | hofN | 377288..377827 (+) | 540 | WP_001069315.1 | DNA utilization protein HofN | - |
| P9060_RS01730 (P9060_01730) | hofO | 377811..378251 (+) | 441 | WP_001055760.1 | DNA utilization protein HofO | - |
| P9060_RS01735 (P9060_01735) | hofP | 378241..378645 (+) | 405 | WP_001264141.1 | DNA utilization protein HofP | - |
| P9060_RS01740 (P9060_01740) | comE | 378557..379795 (+) | 1239 | WP_000815986.1 | DNA uptake porin HofQ | Machinery gene |
| P9060_RS01745 (P9060_01745) | aroK | 380196..380717 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| P9060_RS01750 (P9060_01750) | aroB | 380774..381862 (+) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| P9060_RS01755 (P9060_01755) | damX | 381954..383240 (+) | 1287 | WP_000343204.1 | cell division protein DamX | - |
| P9060_RS01760 (P9060_01760) | dam | 383347..384183 (+) | 837 | WP_000742143.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44743.26 Da Isoelectric Point: 6.3183
>NTDB_id=736971 P9060_RS01740 WP_000815986.1 378557..379795(+) (comE) [Escherichia coli strain rl0044]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSNE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSNE
Nucleotide
Download Length: 1239 bp
>NTDB_id=736971 P9060_RS01740 WP_000815986.1 378557..379795(+) (comE) [Escherichia coli strain rl0044]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGCTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGCCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAATGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGCTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGCCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAATGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.327 |
100 |
0.393 |
| comE | Haemophilus influenzae 86-028NP |
37.097 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.005 |
100 |
0.388 |
| pilQ | Vibrio cholerae strain A1552 |
37.53 |
100 |
0.376 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.53 |
100 |
0.376 |
| comE | Glaesserella parasuis strain SC1401 |
35.714 |
100 |
0.364 |
| pilQ | Pseudomonas aeruginosa PAK |
34.174 |
100 |
0.362 |