Detailed information
Overview
| Name | hexB | Type | Machinery gene |
| Locus tag | GOM48_RS09060 | Genome accession | NZ_CP046523 |
| Coordinates | 1792045..1793994 (-) | Length | 649 a.a. |
| NCBI ID | WP_235097416.1 | Uniprot ID | - |
| Organism | Streptococcus oralis strain SOD | ||
| Function | DNA mismatch repair (predicted from homology) Homologous recombination |
||
Genomic Context
Location: 1787045..1798994
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| GOM48_RS09025 (GOM48_08960) | - | 1787415..1787762 (+) | 348 | WP_213988578.1 | hypothetical protein | - |
| GOM48_RS09030 (GOM48_08965) | - | 1787919..1788953 (+) | 1035 | WP_235097411.1 | S66 peptidase family protein | - |
| GOM48_RS09035 (GOM48_08970) | - | 1789059..1789322 (+) | 264 | WP_000166112.1 | SemiSWEET family transporter | - |
| GOM48_RS09040 (GOM48_08975) | - | 1789394..1790077 (-) | 684 | WP_235097413.1 | CPBP family intramembrane glutamic endopeptidase | - |
| GOM48_RS09045 (GOM48_08980) | - | 1790074..1790637 (-) | 564 | WP_235097415.1 | DNA-3-methyladenine glycosylase I | - |
| GOM48_RS09050 (GOM48_08985) | ruvA | 1790647..1791240 (-) | 594 | WP_084925449.1 | Holliday junction branch migration protein RuvA | Machinery gene |
| GOM48_RS09055 (GOM48_08990) | - | 1791399..1791896 (+) | 498 | WP_235098764.1 | helix-turn-helix domain-containing protein | - |
| GOM48_RS09060 (GOM48_08995) | hexB | 1792045..1793994 (-) | 1950 | WP_235097416.1 | DNA mismatch repair endonuclease MutL | Machinery gene |
| GOM48_RS09065 (GOM48_09000) | - | 1794203..1794643 (+) | 441 | WP_235097418.1 | LytTR family DNA-binding domain-containing protein | - |
| GOM48_RS09070 (GOM48_09005) | - | 1794640..1795098 (+) | 459 | WP_235097420.1 | DUF3021 domain-containing protein | - |
| GOM48_RS09075 (GOM48_09010) | hexA | 1795141..1797675 (-) | 2535 | WP_235097422.1 | DNA mismatch repair protein MutS | Machinery gene |
| GOM48_RS09080 (GOM48_09015) | argR | 1797726..1798172 (-) | 447 | WP_061418468.1 | arginine repressor | - |
Sequence
Protein
Download Length: 649 a.a. Molecular weight: 73332.75 Da Isoelectric Point: 5.5277
>NTDB_id=352745 GOM48_RS09060 WP_235097416.1 1792045..1793994(-) (hexB) [Streptococcus oralis strain SOD]
MSHIIELPEVLANQIAAGEVIERPASVVKELVENAIDAGSSQIIIEIEEAGLKKIQITDNGHGIAHDEVELALRRHATSK
IKNQADLFRIRTLGFRGEALPSIASVSVLTLLTAVDGASHGTKLVARGGQVEEVIPATSPVGTKVCVEDLFFNTPARLKY
MKSQQAELSHIIDIVNRLGLAHPEISFSLISDGKEMTRTAGTGQLRQAIAGIYGLASAKKMIAIENSDLDFEITGFVSLP
ELTRANRNYISLFINGRYIKNFLLNRAILDGYGSKLMVGRFPLAVIHIHIDPYLADVNVHPTKQEVRISKERELMALLSE
AISNSLKEQALIPDALENLAKSTVRNRQKVEQTILPLKENTLYYEKTEVTRPSQAEVADHQVELTEDGQDLTLFAKETLD
QLTKPAKLHFAERKPANYDQLDHPELDLASLDKAYDKLEREESSSFPELEFFGQMHGTYLFAQGRDGLYIIDQHAAQERV
KYEEYRESIGNVDQSQQQLLVPYIFEFPADDALRLRERMPLLEEVGVFLAEYGENQFILREHPIWMAEEEIESGIYEMCD
MLLLTKEVSIKKYRAELAIMMSCKRSIKANHRIDDHSARQLLYQLSQCDNPYNCPHGRPVLVHFTKSDMEKMFRRIQENH
TSLRELGKY
MSHIIELPEVLANQIAAGEVIERPASVVKELVENAIDAGSSQIIIEIEEAGLKKIQITDNGHGIAHDEVELALRRHATSK
IKNQADLFRIRTLGFRGEALPSIASVSVLTLLTAVDGASHGTKLVARGGQVEEVIPATSPVGTKVCVEDLFFNTPARLKY
MKSQQAELSHIIDIVNRLGLAHPEISFSLISDGKEMTRTAGTGQLRQAIAGIYGLASAKKMIAIENSDLDFEITGFVSLP
ELTRANRNYISLFINGRYIKNFLLNRAILDGYGSKLMVGRFPLAVIHIHIDPYLADVNVHPTKQEVRISKERELMALLSE
AISNSLKEQALIPDALENLAKSTVRNRQKVEQTILPLKENTLYYEKTEVTRPSQAEVADHQVELTEDGQDLTLFAKETLD
QLTKPAKLHFAERKPANYDQLDHPELDLASLDKAYDKLEREESSSFPELEFFGQMHGTYLFAQGRDGLYIIDQHAAQERV
KYEEYRESIGNVDQSQQQLLVPYIFEFPADDALRLRERMPLLEEVGVFLAEYGENQFILREHPIWMAEEEIESGIYEMCD
MLLLTKEVSIKKYRAELAIMMSCKRSIKANHRIDDHSARQLLYQLSQCDNPYNCPHGRPVLVHFTKSDMEKMFRRIQENH
TSLRELGKY
Nucleotide
Download Length: 1950 bp
>NTDB_id=352745 GOM48_RS09060 WP_235097416.1 1792045..1793994(-) (hexB) [Streptococcus oralis strain SOD]
ATGTCTCATATTATTGAATTGCCAGAGGTGCTGGCAAACCAAATCGCGGCAGGAGAGGTCATTGAACGTCCTGCCAGTGT
AGTCAAAGAGTTGGTAGAAAATGCCATTGACGCGGGCTCTAGCCAGATTATCATTGAGATTGAGGAAGCTGGTCTCAAGA
AAATCCAAATCACAGATAATGGTCATGGAATTGCCCACGATGAGGTGGAGTTGGCCTTGCGTCGCCATGCGACCAGTAAG
ATAAAAAATCAAGCTGATCTCTTTCGGATTCGGACGCTTGGATTTCGAGGTGAAGCCCTGCCCTCTATCGCCTCTGTTAG
TGTGCTGACTCTGTTGACGGCGGTGGATGGTGCGAGTCATGGGACCAAGCTCGTTGCGCGTGGAGGTCAAGTTGAGGAAG
TCATCCCAGCGACTAGTCCTGTGGGGACCAAAGTTTGTGTGGAGGACCTCTTTTTCAACACGCCTGCCCGCCTCAAGTAT
ATGAAGAGCCAGCAAGCGGAGTTGTCTCATATCATTGATATTGTTAACCGTCTGGGATTGGCTCATCCTGAGATTTCTTT
TAGTTTGATCAGTGATGGCAAGGAAATGACACGGACAGCAGGGACTGGTCAACTACGCCAAGCCATCGCAGGGATTTACG
GTTTGGCGAGTGCTAAGAAGATGATTGCCATTGAGAACTCTGATTTAGATTTCGAAATTACAGGTTTTGTGTCTTTACCT
GAATTGACTCGAGCTAATCGCAACTATATCAGTCTCTTCATCAATGGTCGTTATATCAAGAACTTCCTGCTCAATCGTGC
CATTTTAGATGGTTATGGAAGCAAGCTCATGGTAGGTCGTTTTCCACTGGCAGTCATTCACATCCATATCGATCCTTATC
TGGCTGATGTCAATGTGCATCCAACCAAACAAGAAGTGCGGATTTCTAAGGAAAGAGAACTGATGGCGCTGCTTTCAGAA
GCTATTTCAAATAGTCTCAAGGAACAAGCCTTAATCCCTGATGCCTTGGAAAATCTTGCCAAATCGACCGTGCGCAATCG
TCAAAAGGTAGAGCAGACCATTCTTCCACTCAAAGAAAATACGCTTTACTATGAAAAAACAGAGGTAACAAGACCCAGTC
AAGCTGAGGTAGCTGATCATCAGGTTGAATTAACTGAGGATGGGCAGGATTTAACCCTGTTTGCCAAGGAAACCTTGGAC
CAGTTGACCAAGCCTGCAAAACTGCATTTTGCAGAGAGGAAACCAGCTAACTATGACCAACTAGACCATCCAGAGCTAGA
CCTTGCCAGTCTGGATAAGGCCTATGACAAGCTGGAGAGAGAAGAATCATCAAGCTTCCCAGAGTTGGAATTTTTTGGAC
AAATGCACGGGACTTATCTCTTTGCCCAAGGGCGAGATGGGCTCTACATCATAGACCAGCACGCGGCTCAGGAAAGGGTC
AAGTACGAGGAATACCGTGAAAGCATTGGGAATGTTGACCAGAGTCAGCAGCAACTCCTAGTACCTTACATCTTTGAGTT
TCCTGCGGATGATGCCCTTCGTCTTAGAGAAAGAATGCCTCTCTTAGAGGAAGTGGGCGTCTTTCTAGCAGAGTACGGAG
AAAATCAATTTATTCTACGTGAACATCCTATTTGGATGGCAGAGGAAGAAATCGAGTCTGGCATCTATGAAATGTGTGAC
ATGCTGCTCTTGACCAAGGAAGTTTCTATCAAGAAATACCGAGCGGAGCTGGCTATCATGATGTCCTGCAAGCGGTCTAT
CAAGGCCAATCACCGTATCGATGACCACTCAGCCAGACAGCTCCTTTATCAGCTCTCTCAATGCGACAACCCATATAACT
GTCCTCATGGACGTCCTGTTTTGGTGCATTTCACCAAGTCGGATATGGAAAAAATGTTCCGACGCATTCAGGAAAATCAT
ACTAGCCTCCGTGAGTTGGGGAAATATTAA
ATGTCTCATATTATTGAATTGCCAGAGGTGCTGGCAAACCAAATCGCGGCAGGAGAGGTCATTGAACGTCCTGCCAGTGT
AGTCAAAGAGTTGGTAGAAAATGCCATTGACGCGGGCTCTAGCCAGATTATCATTGAGATTGAGGAAGCTGGTCTCAAGA
AAATCCAAATCACAGATAATGGTCATGGAATTGCCCACGATGAGGTGGAGTTGGCCTTGCGTCGCCATGCGACCAGTAAG
ATAAAAAATCAAGCTGATCTCTTTCGGATTCGGACGCTTGGATTTCGAGGTGAAGCCCTGCCCTCTATCGCCTCTGTTAG
TGTGCTGACTCTGTTGACGGCGGTGGATGGTGCGAGTCATGGGACCAAGCTCGTTGCGCGTGGAGGTCAAGTTGAGGAAG
TCATCCCAGCGACTAGTCCTGTGGGGACCAAAGTTTGTGTGGAGGACCTCTTTTTCAACACGCCTGCCCGCCTCAAGTAT
ATGAAGAGCCAGCAAGCGGAGTTGTCTCATATCATTGATATTGTTAACCGTCTGGGATTGGCTCATCCTGAGATTTCTTT
TAGTTTGATCAGTGATGGCAAGGAAATGACACGGACAGCAGGGACTGGTCAACTACGCCAAGCCATCGCAGGGATTTACG
GTTTGGCGAGTGCTAAGAAGATGATTGCCATTGAGAACTCTGATTTAGATTTCGAAATTACAGGTTTTGTGTCTTTACCT
GAATTGACTCGAGCTAATCGCAACTATATCAGTCTCTTCATCAATGGTCGTTATATCAAGAACTTCCTGCTCAATCGTGC
CATTTTAGATGGTTATGGAAGCAAGCTCATGGTAGGTCGTTTTCCACTGGCAGTCATTCACATCCATATCGATCCTTATC
TGGCTGATGTCAATGTGCATCCAACCAAACAAGAAGTGCGGATTTCTAAGGAAAGAGAACTGATGGCGCTGCTTTCAGAA
GCTATTTCAAATAGTCTCAAGGAACAAGCCTTAATCCCTGATGCCTTGGAAAATCTTGCCAAATCGACCGTGCGCAATCG
TCAAAAGGTAGAGCAGACCATTCTTCCACTCAAAGAAAATACGCTTTACTATGAAAAAACAGAGGTAACAAGACCCAGTC
AAGCTGAGGTAGCTGATCATCAGGTTGAATTAACTGAGGATGGGCAGGATTTAACCCTGTTTGCCAAGGAAACCTTGGAC
CAGTTGACCAAGCCTGCAAAACTGCATTTTGCAGAGAGGAAACCAGCTAACTATGACCAACTAGACCATCCAGAGCTAGA
CCTTGCCAGTCTGGATAAGGCCTATGACAAGCTGGAGAGAGAAGAATCATCAAGCTTCCCAGAGTTGGAATTTTTTGGAC
AAATGCACGGGACTTATCTCTTTGCCCAAGGGCGAGATGGGCTCTACATCATAGACCAGCACGCGGCTCAGGAAAGGGTC
AAGTACGAGGAATACCGTGAAAGCATTGGGAATGTTGACCAGAGTCAGCAGCAACTCCTAGTACCTTACATCTTTGAGTT
TCCTGCGGATGATGCCCTTCGTCTTAGAGAAAGAATGCCTCTCTTAGAGGAAGTGGGCGTCTTTCTAGCAGAGTACGGAG
AAAATCAATTTATTCTACGTGAACATCCTATTTGGATGGCAGAGGAAGAAATCGAGTCTGGCATCTATGAAATGTGTGAC
ATGCTGCTCTTGACCAAGGAAGTTTCTATCAAGAAATACCGAGCGGAGCTGGCTATCATGATGTCCTGCAAGCGGTCTAT
CAAGGCCAATCACCGTATCGATGACCACTCAGCCAGACAGCTCCTTTATCAGCTCTCTCAATGCGACAACCCATATAACT
GTCCTCATGGACGTCCTGTTTTGGTGCATTTCACCAAGTCGGATATGGAAAAAATGTTCCGACGCATTCAGGAAAATCAT
ACTAGCCTCCGTGAGTTGGGGAAATATTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| hexB | Streptococcus pneumoniae R6 |
96.456 |
100 |
0.965 |