Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | JSQ86_RS01780 | Genome accession | NZ_CP069707 |
| Coordinates | 388896..390134 (+) | Length | 412 a.a. |
| NCBI ID | WP_204098122.1 | Uniprot ID | - |
| Organism | Escherichia coli strain E41 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 383896..395134
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| JSQ86_RS01755 (JSQ86_01755) | mrcA | 384177..386729 (-) | 2553 | WP_113078398.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| JSQ86_RS01760 (JSQ86_01760) | hofM | 386849..387628 (+) | 780 | WP_001295166.1 | DNA utilization protein HofM | - |
| JSQ86_RS01765 (JSQ86_01765) | hofN | 387628..388167 (+) | 540 | WP_001069315.1 | DNA utilization protein HofN | - |
| JSQ86_RS01770 (JSQ86_01770) | hofO | 388151..388576 (+) | 426 | Protein_359 | DNA utilization protein HofO | - |
| JSQ86_RS01775 (JSQ86_01775) | hofP | 388580..388984 (+) | 405 | WP_113078407.1 | DNA utilization protein HofP | - |
| JSQ86_RS01780 (JSQ86_01780) | comE | 388896..390134 (+) | 1239 | WP_204098122.1 | DNA uptake porin HofQ | Machinery gene |
| JSQ86_RS01785 (JSQ86_01785) | aroK | 390535..391056 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| JSQ86_RS01790 (JSQ86_01790) | aroB | 391113..392201 (+) | 1089 | WP_204098123.1 | 3-dehydroquinate synthase | - |
| JSQ86_RS01795 (JSQ86_01795) | damX | 392293..393579 (+) | 1287 | WP_000343195.1 | cell division protein DamX | - |
| JSQ86_RS01800 (JSQ86_01800) | dam | 393686..394522 (+) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44706.20 Da Isoelectric Point: 6.3183
>NTDB_id=469823 JSQ86_RS01780 WP_204098122.1 388896..390134(+) (comE) [Escherichia coli strain E41]
MKQWIAALLLMLIPGVQAAKSQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKSQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSIAWQNNNIARQEAEQARAQANLPLENRSITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSALEQWVAQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQHAGGVGQVTTLGSDLSVATATTHVGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=469823 JSQ86_RS01780 WP_204098122.1 388896..390134(+) (comE) [Escherichia coli strain E41]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGTCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGCTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTGATACCCGGCGTACAGGCGGCAAAGTCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTCGTGTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATCTAACAGATGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGACTG
ATAACGCGGCAGGAAGGCAACATTCTCTCAGTGCATTCCATTGCCTGGCAGAATAACAATATCGCCCGCCAGGAGGCGGA
GCAGGCGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAGTATAACCCTGCAATACGCCGACGCGGGAGAACTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTACGAGATAAC
AAAACGGCGTTAAGCGCGCTTGAACAGTGGGTAGCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGCGTGAAATGGACGCTGGCCGATGCGCAACACGCTGGTGGCGTTG
GGCAAGTCACCACGCTTGGTAGCGACCTCTCCGTAGCGACGGCGACAACGCATGTCGGTTTTAACATTGGGCGCATCAAC
GGACGCTTGCTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAGGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCCGATGGCGAAGTGCTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae Rd KW20 |
36.927 |
100 |
0.391 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.005 |
100 |
0.388 |
| comE | Haemophilus influenzae 86-028NP |
39.043 |
96.359 |
0.376 |
| pilQ | Vibrio cholerae strain A1552 |
37.53 |
100 |
0.376 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.53 |
100 |
0.376 |
| comE | Glaesserella parasuis strain SC1401 |
35.952 |
100 |
0.367 |
| pilQ | Pseudomonas aeruginosa PAK |
33.864 |
100 |
0.362 |