Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | ACNHKQ_RS21080 | Genome accession | NZ_CP182139 |
| Coordinates | 4283175..4284413 (-) | Length | 412 a.a. |
| NCBI ID | WP_000815972.1 | Uniprot ID | - |
| Organism | Escherichia coli strain CUWW06 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 4278175..4289413
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| ACNHKQ_RS21060 (ACNHKQ_21060) | dam | 4278787..4279623 (-) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
| ACNHKQ_RS21065 (ACNHKQ_21065) | damX | 4279730..4281016 (-) | 1287 | WP_000343210.1 | cell division protein DamX | - |
| ACNHKQ_RS21070 (ACNHKQ_21070) | aroB | 4281108..4282196 (-) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| ACNHKQ_RS21075 (ACNHKQ_21075) | aroK | 4282253..4282774 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| ACNHKQ_RS21080 (ACNHKQ_21080) | comE | 4283175..4284413 (-) | 1239 | WP_000815972.1 | DNA uptake porin HofQ | Machinery gene |
| ACNHKQ_RS21085 (ACNHKQ_21085) | hofP | 4284325..4284729 (-) | 405 | WP_001264141.1 | DNA utilization protein HofP | - |
| ACNHKQ_RS21090 (ACNHKQ_21090) | hofO | 4284719..4285159 (-) | 441 | WP_032281706.1 | DNA utilization protein HofO | - |
| ACNHKQ_RS21095 (ACNHKQ_21095) | hofN | 4285143..4285682 (-) | 540 | WP_032281707.1 | DNA utilization protein HofN | - |
| ACNHKQ_RS21100 (ACNHKQ_21100) | hofM | 4285682..4286461 (-) | 780 | WP_032281708.1 | DNA utilization protein HofM | - |
| ACNHKQ_RS21105 (ACNHKQ_21105) | mrcA | 4286581..4289133 (+) | 2553 | WP_032281709.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44735.24 Da Isoelectric Point: 5.9488
>NTDB_id=979543 ACNHKQ_RS21080 WP_000815972.1 4283175..4284413(-) (comE) [Escherichia coli strain CUWW06]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=979543 ACNHKQ_RS21080 WP_000815972.1 4283175..4284413(-) (comE) [Escherichia coli strain CUWW06]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCCCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCTGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCTAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAAGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCAGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGCCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAAAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCCCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGTTTGCTGGATCTTGAGCTTTCTGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCTAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAAGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCAGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTGCCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| comE | Haemophilus influenzae 86-028NP |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.714 |
100 |
0.364 |
| pilQ | Pseudomonas aeruginosa PAK |
34.174 |
100 |
0.362 |