Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | ACI3MO_RS10225 | Genome accession | NZ_CP173480 |
| Coordinates | 2068567..2069805 (-) | Length | 412 a.a. |
| NCBI ID | WP_404998539.1 | Uniprot ID | - |
| Organism | Escherichia coli strain 98222 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 2063567..2074805
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| ACI3MO_RS10205 (ACI3MO_10205) | dam | 2064179..2065015 (-) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
| ACI3MO_RS10210 (ACI3MO_10210) | damX | 2065122..2066408 (-) | 1287 | WP_021523282.1 | cell division protein DamX | - |
| ACI3MO_RS10215 (ACI3MO_10215) | aroB | 2066500..2067588 (-) | 1089 | WP_020232886.1 | 3-dehydroquinate synthase | - |
| ACI3MO_RS10220 (ACI3MO_10220) | aroK | 2067645..2068166 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| ACI3MO_RS10225 (ACI3MO_10225) | comE | 2068567..2069805 (-) | 1239 | WP_404998539.1 | DNA uptake porin HofQ | Machinery gene |
| ACI3MO_RS10230 (ACI3MO_10230) | hofP | 2069717..2070121 (-) | 405 | WP_001521465.1 | DNA utilization protein HofP | - |
| ACI3MO_RS10235 (ACI3MO_10235) | hofO | 2070111..2070551 (-) | 441 | WP_000367366.1 | DNA utilization protein HofO | - |
| ACI3MO_RS10240 (ACI3MO_10240) | hofN | 2070535..2071074 (-) | 540 | WP_001069323.1 | DNA utilization protein HofN | - |
| ACI3MO_RS10245 (ACI3MO_10245) | hofM | 2071074..2071853 (-) | 780 | WP_001445781.1 | DNA utilization protein HofM | - |
| ACI3MO_RS10250 (ACI3MO_10250) | mrcA | 2071973..2074525 (+) | 2553 | WP_001301905.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44725.20 Da Isoelectric Point: 5.9488
>NTDB_id=959635 ACI3MO_RS10225 WP_404998539.1 2068567..2069805(-) (comE) [Escherichia coli strain 98222]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLSLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNDNIARQEAEQARAQANLSLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=959635 ACI3MO_RS10225 WP_404998539.1 2068567..2069805(-) (comE) [Escherichia coli strain 98222]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGTCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCCCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTTGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGTTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATGACAATATCGCCCGTCAGGAAGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGTCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCTGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCCCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACAAGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTTGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGTTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
36.591 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| comE | Haemophilus influenzae 86-028NP |
36.364 |
100 |
0.388 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.476 |
100 |
0.362 |