Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | EC1639_RS22630 | Genome accession | NZ_LR025101 |
| Coordinates | 4658263..4659501 (-) | Length | 412 a.a. |
| NCBI ID | WP_000815995.1 | Uniprot ID | - |
| Organism | Escherichia coli isolate EC-1639 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 4653263..4664501
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| EC1639_RS22610 (EC1639_04512) | dam | 4653875..4654711 (-) | 837 | WP_000742139.1 | adenine-specific DNA-methyltransferase | - |
| EC1639_RS22615 (EC1639_04513) | damX | 4654818..4656104 (-) | 1287 | WP_000343227.1 | cell division protein DamX | - |
| EC1639_RS22620 (EC1639_04514) | aroB | 4656196..4657284 (-) | 1089 | WP_000439850.1 | 3-dehydroquinate synthase | - |
| EC1639_RS22625 (EC1639_04515) | aroK | 4657341..4657862 (-) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| EC1639_RS22630 (EC1639_04516) | comE | 4658263..4659501 (-) | 1239 | WP_000815995.1 | DNA uptake porin HofQ | Machinery gene |
| EC1639_RS22635 (EC1639_04517) | hofP | 4659413..4659817 (-) | 405 | WP_001264137.1 | DNA utilization protein HofP | - |
| EC1639_RS22640 (EC1639_04518) | hofO | 4659807..4660247 (-) | 441 | WP_000367370.1 | DNA utilization protein HofO | - |
| EC1639_RS22645 (EC1639_04519) | hofN | 4660231..4660770 (-) | 540 | WP_001069326.1 | DNA utilization protein HofN | - |
| EC1639_RS22650 (EC1639_04520) | hofM | 4660770..4661549 (-) | 780 | WP_001306315.1 | DNA utilization protein HofM | - |
| EC1639_RS22655 (EC1639_04521) | mrcA | 4661669..4664221 (+) | 2553 | WP_001301905.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44730.22 Da Isoelectric Point: 6.1173
>NTDB_id=992836 EC1639_RS22630 WP_000815995.1 4658263..4659501(-) (comE) [Escherichia coli isolate EC-1639]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQARAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=992836 EC1639_RS22630 WP_000815995.1 4658263..4659501(-) (comE) [Escherichia coli isolate EC-1639]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGTGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAAGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGTCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGTCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGTTGGCTGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTTACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGTGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae 86-028NP |
37.3 |
100 |
0.396 |
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.242 |
100 |
0.391 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.952 |
100 |
0.367 |
| pilQ | Pseudomonas aeruginosa PAK |
34.174 |
100 |
0.362 |