Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | ACHP5S_RS18780 | Genome accession | NZ_CP172127 |
| Coordinates | 3884651..3885889 (+) | Length | 412 a.a. |
| NCBI ID | WP_096983595.1 | Uniprot ID | - |
| Organism | Escherichia coli strain GF43 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 3879651..3890889
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| ACHP5S_RS18755 (ACHP5S_18755) | mrcA | 3879931..3882483 (-) | 2553 | WP_042002839.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| ACHP5S_RS18760 (ACHP5S_18760) | hofM | 3882603..3883382 (+) | 780 | WP_096983599.1 | DNA utilization protein HofM | - |
| ACHP5S_RS18765 (ACHP5S_18765) | hofN | 3883382..3883921 (+) | 540 | WP_096983598.1 | DNA utilization protein HofN | - |
| ACHP5S_RS18770 (ACHP5S_18770) | hofO | 3883905..3884345 (+) | 441 | WP_096983597.1 | DNA utilization protein HofO | - |
| ACHP5S_RS18775 (ACHP5S_18775) | hofP | 3884335..3884739 (+) | 405 | WP_096983596.1 | DNA utilization protein HofP | - |
| ACHP5S_RS18780 (ACHP5S_18780) | comE | 3884651..3885889 (+) | 1239 | WP_096983595.1 | DNA uptake porin HofQ | Machinery gene |
| ACHP5S_RS18785 (ACHP5S_18785) | aroK | 3886290..3886811 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| ACHP5S_RS18790 (ACHP5S_18790) | aroB | 3886868..3887956 (+) | 1089 | WP_042002841.1 | 3-dehydroquinate synthase | - |
| ACHP5S_RS18795 (ACHP5S_18795) | damX | 3888048..3889334 (+) | 1287 | WP_096983594.1 | cell division protein DamX | - |
| ACHP5S_RS18800 (ACHP5S_18800) | dam | 3889441..3890277 (+) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44720.26 Da Isoelectric Point: 5.9488
>NTDB_id=950175 ACHP5S_RS18780 WP_096983595.1 3884651..3885889(+) (comE) [Escherichia coli strain GF43]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELLAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELLAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=950175 ACHP5S_RS18780 WP_096983595.1 3884651..3885889(+) (comE) [Escherichia coli strain GF43]
ATGAAGCAATGGATAGCAGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACACTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCCGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTTGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGTGGCATTTTTACCCGTAAAAATAAATCGGGGCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCAGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACACTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCCGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTTGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCTCATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGTGGCATTTTTACCCGTAAAAATAAATCGGGGCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| comE | Haemophilus influenzae 86-028NP |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.714 |
100 |
0.364 |
| pilQ | Pseudomonas aeruginosa PAK |
34.174 |
100 |
0.362 |