Detailed information
Overview
| Name | comE | Type | Machinery gene |
| Locus tag | K8B79_RS01750 | Genome accession | NZ_CP082824 |
| Coordinates | 390795..392033 (+) | Length | 412 a.a. |
| NCBI ID | WP_000816006.1 | Uniprot ID | - |
| Organism | Escherichia coli strain SCAID URN1-2021 (19/278) | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 385795..397033
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| K8B79_RS01725 (K8B79_01725) | mrcA | 386075..388627 (-) | 2553 | WP_001298208.1 | peptidoglycan glycosyltransferase/peptidoglycan DD-transpeptidase MrcA | - |
| K8B79_RS01730 (K8B79_01730) | hofM | 388747..389526 (+) | 780 | WP_001296474.1 | DNA utilization protein HofM | - |
| K8B79_RS01735 (K8B79_01735) | hofN | 389526..390065 (+) | 540 | WP_001069307.1 | DNA utilization protein HofN | - |
| K8B79_RS01740 (K8B79_01740) | hofO | 390049..390489 (+) | 441 | WP_001055744.1 | DNA utilization protein HofO | - |
| K8B79_RS01745 (K8B79_01745) | hofP | 390479..390883 (+) | 405 | WP_001264138.1 | DNA utilization protein HofP | - |
| K8B79_RS01750 (K8B79_01750) | comE | 390795..392033 (+) | 1239 | WP_000816006.1 | DNA uptake porin HofQ | Machinery gene |
| K8B79_RS01755 (K8B79_01755) | aroK | 392434..392955 (+) | 522 | WP_000818618.1 | shikimate kinase AroK | - |
| K8B79_RS01760 (K8B79_01760) | aroB | 393012..394100 (+) | 1089 | WP_001356903.1 | 3-dehydroquinate synthase | - |
| K8B79_RS01765 (K8B79_01765) | damX | 394192..395478 (+) | 1287 | WP_000343176.1 | cell division protein DamX | - |
| K8B79_RS01770 (K8B79_01770) | dam | 395585..396421 (+) | 837 | WP_000742141.1 | adenine-specific DNA-methyltransferase | - |
Sequence
Protein
Download Length: 412 a.a. Molecular weight: 44797.26 Da Isoelectric Point: 5.9488
>NTDB_id=529988 K8B79_RS01750 WP_000816006.1 390795..392033(+) (comE) [Escherichia coli strain SCAID URN1-2021 (19/278)]
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQTRAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSTLEQWVSQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQGGGVGQVTTLGSDLSVATATTHIGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
MKQWIAALLLMLIPGVQAAKPQKVTLMVDDVPVAQVLQALAEQEKLNLVVSPDVSGTVSLHLTDVPWKQALQTVVKSAGL
ITRQEGNILSVHSVAWQNDNIARQEAEQTRAQANLPLENRNITLQYADAGELAKAGEKLLSAKGSMTVDKRTNRLLLRDN
KTALSTLEQWVSQMDLPVGQVELSAHIVTINEKSLRELGVKWTLADAQQGGGVGQVTTLGSDLSVATATTHIGFNIGRIN
GRLLDLELSALEQKQQLDIIASPRLLASHLQPASIKQGSEIPYQVSSGESGATSVEFKEAVLGMEVTPTVLQKGRIRLKL
HISQNVPGQVLQQADGEVLAIDKQEIETQVEVKSGETLALGGIFTRKNKSGQDSVPLLGDIPWFGQLFRHDGKEDERREL
VVFITPRLVSSE
Nucleotide
Download Length: 1239 bp
>NTDB_id=529988 K8B79_RS01750 WP_000816006.1 390795..392033(+) (comE) [Escherichia coli strain SCAID URN1-2021 (19/278)]
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTTATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTTTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATTTAACTGACGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGATTG
ATAACGCGCCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGACGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCACGCTTGAACAGTGGGTATCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGTGTGAAATGGACGTTGGCCGATGCGCAACAAGGTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATATCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCAGATGGCGAAGTACTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
ATGAAGCAATGGATAGCCGCACTACTGTTGATGCTTATACCCGGCGTACAGGCGGCAAAGCCGCAAAAAGTGACGCTGAT
GGTGGATGACGTTCCGGTAGCTCAGGTGTTGCAGGCGCTGGCTGAACAGGAGAAGTTGAACCTGGTGGTTTCGCCAGACG
TCAGCGGTACGGTGTCGTTACATTTAACTGACGTTCCCTGGAAGCAGGCACTACAAACTGTAGTGAAAAGCGCCGGATTG
ATAACGCGCCAGGAGGGCAACATTCTCTCGGTGCATTCCGTTGCCTGGCAGAATGACAATATCGCCCGCCAGGAGGCGGA
GCAGACGCGGGCGCAGGCAAATCTGCCGCTGGAAAATCGCAATATTACTCTGCAATACGCCGACGCCGGAGAGCTGGCGA
AAGCGGGGGAGAAGCTACTGAGTGCCAAAGGGAGTATGACCGTCGATAAACGCACCAATCGCCTTTTGCTGCGAGATAAC
AAAACGGCGTTAAGCACGCTTGAACAGTGGGTATCGCAAATGGATCTGCCGGTCGGGCAGGTTGAGCTGTCGGCGCATAT
TGTCACCATTAATGAAAAAAGTTTGCGTGAGTTAGGTGTGAAATGGACGTTGGCCGATGCGCAACAAGGTGGTGGCGTTG
GGCAAGTCACCACGCTTGGCAGCGACCTCTCCGTAGCGACGGCGACAACGCATATCGGTTTTAACATTGGACGCATCAAC
GGACGTTTACTGGATCTTGAGCTTTCCGCGCTCGAACAAAAACAGCAGCTGGATATTATCGCCAGTCCGCGTCTGCTGGC
CTCACATCTTCAGCCTGCCAGCATTAAACAGGGGAGCGAAATTCCATATCAGGTTTCCAGCGGGGAAAGTGGCGCGACGT
CGGTGGAATTTAAAGAGGCCGTCCTGGGGATGGAAGTCACGCCCACGGTGTTACAAAAAGGTCGCATCCGGCTGAAATTA
CACATCAGCCAGAACGTTCCGGGGCAGGTGCTACAGCAGGCAGATGGCGAAGTACTGGCGATTGATAAGCAGGAGATCGA
AACGCAGGTCGAGGTCAAAAGCGGAGAAACGTTGGCGCTGGGCGGCATTTTTACCCGTAAAAATAAATCGGGTCAGGATA
GCGTACCGTTGCTTGGCGACATTCCCTGGTTCGGGCAATTATTTCGTCATGACGGAAAAGAAGATGAACGACGCGAGTTA
GTGGTGTTTATCACGCCACGACTGGTTTCCAGTGAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comE | Haemophilus influenzae 86-028NP |
37.3 |
100 |
0.396 |
| pilQ | Vibrio campbellii strain DS40M4 |
38.48 |
100 |
0.393 |
| comE | Haemophilus influenzae Rd KW20 |
37.156 |
100 |
0.393 |
| pilQ | Vibrio cholerae strain A1552 |
37.772 |
100 |
0.379 |
| pilQ | Vibrio cholerae O1 biovar El Tor strain E7946 |
37.772 |
100 |
0.379 |
| comE | Glaesserella parasuis strain SC1401 |
35.782 |
100 |
0.367 |
| pilQ | Pseudomonas aeruginosa PAK |
34.633 |
100 |
0.367 |