Detailed information
Overview
| Name | hexB | Type | Machinery gene |
| Locus tag | SAIN_RS08990 | Genome accession | NC_022244 |
| Coordinates | 1817807..1819753 (-) | Length | 648 a.a. |
| NCBI ID | WP_003026650.1 | Uniprot ID | - |
| Organism | Streptococcus anginosus C1051 | ||
| Function | DNA mismatch repair (predicted from homology) Homologous recombination |
||
Genomic Context
Location: 1812807..1824753
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| SAIN_RS08965 (SAIN_1748) | cinA | 1813179..1814450 (-) | 1272 | WP_021002200.1 | competence/damage-inducible protein A | Machinery gene |
| SAIN_RS08970 | - | 1815051..1815471 (+) | 421 | Protein_1742 | EamA family transporter | - |
| SAIN_RS08975 (SAIN_1749) | - | 1815574..1816152 (-) | 579 | WP_021002201.1 | DNA-3-methyladenine glycosylase I | - |
| SAIN_RS08980 (SAIN_1750) | ruvA | 1816163..1816753 (-) | 591 | WP_021002202.1 | Holliday junction branch migration protein RuvA | Machinery gene |
| SAIN_RS08985 (SAIN_1751) | - | 1816915..1817424 (+) | 510 | WP_003026648.1 | helix-turn-helix domain-containing protein | - |
| SAIN_RS08990 (SAIN_1752) | hexB | 1817807..1819753 (-) | 1947 | WP_003026650.1 | DNA mismatch repair endonuclease MutL | Machinery gene |
| SAIN_RS08995 (SAIN_1753) | brsR | 1819998..1820438 (+) | 441 | WP_041784066.1 | LytTR family DNA-binding domain-containing protein | Regulator |
| SAIN_RS09000 (SAIN_1754) | - | 1820435..1820893 (+) | 459 | WP_021002204.1 | DUF3021 domain-containing protein | - |
| SAIN_RS09005 (SAIN_1755) | hexA | 1821082..1823643 (-) | 2562 | WP_021002205.1 | DNA mismatch repair protein MutS | Machinery gene |
| SAIN_RS09010 (SAIN_1756) | argR | 1823806..1824246 (-) | 441 | WP_003027809.1 | arginine repressor | - |
Sequence
Protein
Download Length: 648 a.a. Molecular weight: 73161.36 Da Isoelectric Point: 5.1688
>NTDB_id=50949 SAIN_RS08990 WP_003026650.1 1817807..1819753(-) (hexB) [Streptococcus anginosus C1051]
MSKIIELPENLANQIAAGEVIERPSSVVKELIENSIDAGATQIIVEIEEAGLRSIQVIDNGEGIEHEEVSLALRRHATSK
IKKQADLFRIRTLGFRGEALPSIASVSRLTIETATSSGAHGTLLIAQGGEVETLEPSSCPRGTKIKVEDLFFNTPARLKY
MKSQQAELSHIVDVINRLSLAHPEVAFTLVNDGKEMTRTAGTGNLRQAIAGIYGLTTAKKMIEILASDLDFEVSGYISLP
ELTRANRNYITILINGRYIKNFLLNRAILDGYGSKLMVGRFPIAVIDIRIDPYLADVNVHPTKQEVRISKERELMVLISQ
AIAASLKEQDLIPDALENLAKSTINRAIKPEQTSLPLKENRLYYDKERNDFFVKPQVSEAQPSFEESARLDQQSADTDEL
NSKAASVKFAERQSPSYNQLDHPELDQASLERALDKLNGEETSTFPELEYFGQMHGTYLFAQGNGGLYIIDQHAAQERVK
YEYYREKIGDVDASQQQLLVPYIFEFPADDMLRLKQRMTLLEEVGVFLEEYGTNQFILREHPIWLKEEEIESGIYEMCDM
LLLTKEVSIKKYRAELAIMMSCKRSIKANHSLDDYSARDLIFQLSQCDNPYNCPHGRPVLVNFTKSDMGKMFRRIQENHT
SLRELGKY
MSKIIELPENLANQIAAGEVIERPSSVVKELIENSIDAGATQIIVEIEEAGLRSIQVIDNGEGIEHEEVSLALRRHATSK
IKKQADLFRIRTLGFRGEALPSIASVSRLTIETATSSGAHGTLLIAQGGEVETLEPSSCPRGTKIKVEDLFFNTPARLKY
MKSQQAELSHIVDVINRLSLAHPEVAFTLVNDGKEMTRTAGTGNLRQAIAGIYGLTTAKKMIEILASDLDFEVSGYISLP
ELTRANRNYITILINGRYIKNFLLNRAILDGYGSKLMVGRFPIAVIDIRIDPYLADVNVHPTKQEVRISKERELMVLISQ
AIAASLKEQDLIPDALENLAKSTINRAIKPEQTSLPLKENRLYYDKERNDFFVKPQVSEAQPSFEESARLDQQSADTDEL
NSKAASVKFAERQSPSYNQLDHPELDQASLERALDKLNGEETSTFPELEYFGQMHGTYLFAQGNGGLYIIDQHAAQERVK
YEYYREKIGDVDASQQQLLVPYIFEFPADDMLRLKQRMTLLEEVGVFLEEYGTNQFILREHPIWLKEEEIESGIYEMCDM
LLLTKEVSIKKYRAELAIMMSCKRSIKANHSLDDYSARDLIFQLSQCDNPYNCPHGRPVLVNFTKSDMGKMFRRIQENHT
SLRELGKY
Nucleotide
Download Length: 1947 bp
>NTDB_id=50949 SAIN_RS08990 WP_003026650.1 1817807..1819753(-) (hexB) [Streptococcus anginosus C1051]
ATGTCAAAAATTATTGAACTACCAGAAAATCTTGCTAATCAGATTGCAGCAGGTGAGGTTATTGAGCGACCTAGCAGCGT
TGTCAAGGAGTTAATAGAAAATTCTATTGATGCTGGTGCCACTCAGATTATAGTTGAGATTGAAGAAGCGGGACTCAGGA
GCATTCAAGTCATTGATAATGGTGAAGGAATTGAGCATGAGGAGGTTTCCTTGGCTTTACGGCGGCATGCTACTAGTAAA
ATCAAGAAACAAGCCGACCTTTTTCGAATTCGGACATTGGGCTTTCGGGGCGAGGCACTTCCATCCATTGCCTCTGTTTC
ACGTTTGACGATTGAAACTGCGACAAGTAGTGGTGCACATGGAACGCTTCTGATTGCGCAAGGTGGAGAAGTTGAGACTT
TAGAGCCAAGTAGCTGTCCTAGGGGCACCAAAATCAAAGTGGAAGACCTTTTTTTCAACACGCCTGCTCGCTTGAAATAT
ATGAAAAGTCAACAAGCGGAACTATCTCACATTGTAGATGTGATTAACCGTTTGAGCTTGGCTCATCCGGAGGTCGCTTT
CACTCTTGTTAATGACGGTAAAGAGATGACACGGACAGCAGGAACAGGAAATCTGCGTCAAGCAATTGCTGGCATTTATG
GACTGACAACAGCCAAAAAAATGATTGAAATTTTAGCATCTGATTTGGATTTTGAAGTATCAGGCTATATTAGTTTGCCA
GAATTAACAAGGGCTAATCGGAATTACATTACTATCCTCATCAATGGTCGCTACATCAAGAATTTCCTACTCAATCGAGC
TATTTTAGATGGATATGGTAGCAAGCTCATGGTGGGACGTTTTCCGATTGCTGTGATTGATATTCGGATTGACCCATATC
TTGCTGATGTCAATGTTCACCCGACCAAGCAAGAAGTGCGGATTTCAAAGGAGCGAGAGCTCATGGTCTTGATATCGCAA
GCTATTGCTGCAAGTTTGAAAGAGCAAGATTTGATTCCGGACGCATTAGAGAATTTAGCCAAATCAACCATTAACCGAGC
AATTAAGCCTGAACAGACCAGCCTCCCTCTCAAAGAGAACCGACTTTATTACGATAAAGAAAGAAATGACTTCTTTGTGA
AACCACAAGTGTCAGAAGCTCAACCTTCTTTTGAGGAATCTGCCCGATTAGACCAACAATCTGCTGATACAGATGAACTC
AATTCAAAAGCTGCTTCTGTCAAATTTGCAGAAAGGCAATCTCCTTCTTACAATCAACTAGATCATCCAGAGCTGGATCA
GGCGAGCTTAGAGAGAGCTTTAGATAAGCTAAATGGAGAAGAAACTTCAACGTTTCCAGAATTGGAATATTTCGGGCAAA
TGCACGGCACCTACCTTTTTGCTCAAGGAAACGGTGGCCTTTATATTATTGACCAACATGCAGCTCAAGAGCGAGTAAAG
TACGAATATTACCGTGAAAAAATCGGAGATGTAGATGCTAGTCAGCAGCAGCTTCTGGTTCCCTATATCTTTGAATTTCC
AGCTGATGATATGTTGCGTCTGAAACAACGAATGACTCTTTTAGAAGAAGTCGGTGTTTTCCTTGAAGAATACGGAACTA
ATCAATTTATTCTTCGTGAACATCCCATTTGGCTTAAGGAAGAGGAGATCGAATCAGGTATTTATGAGATGTGCGATATG
CTGCTTCTAACCAAGGAAGTCTCTATCAAGAAATATCGCGCTGAGCTGGCTATTATGATGAGTTGCAAACGCTCTATTAA
AGCCAATCACAGTTTAGATGACTATTCAGCGCGTGATTTGATTTTTCAGTTATCACAATGCGACAATCCCTACAACTGCC
CTCACGGTCGTCCCGTTTTGGTCAACTTCACCAAATCTGATATGGGAAAAATGTTCCGTCGGATTCAGGAAAACCATACT
AGCCTGAGAGAATTGGGCAAGTATTAA
ATGTCAAAAATTATTGAACTACCAGAAAATCTTGCTAATCAGATTGCAGCAGGTGAGGTTATTGAGCGACCTAGCAGCGT
TGTCAAGGAGTTAATAGAAAATTCTATTGATGCTGGTGCCACTCAGATTATAGTTGAGATTGAAGAAGCGGGACTCAGGA
GCATTCAAGTCATTGATAATGGTGAAGGAATTGAGCATGAGGAGGTTTCCTTGGCTTTACGGCGGCATGCTACTAGTAAA
ATCAAGAAACAAGCCGACCTTTTTCGAATTCGGACATTGGGCTTTCGGGGCGAGGCACTTCCATCCATTGCCTCTGTTTC
ACGTTTGACGATTGAAACTGCGACAAGTAGTGGTGCACATGGAACGCTTCTGATTGCGCAAGGTGGAGAAGTTGAGACTT
TAGAGCCAAGTAGCTGTCCTAGGGGCACCAAAATCAAAGTGGAAGACCTTTTTTTCAACACGCCTGCTCGCTTGAAATAT
ATGAAAAGTCAACAAGCGGAACTATCTCACATTGTAGATGTGATTAACCGTTTGAGCTTGGCTCATCCGGAGGTCGCTTT
CACTCTTGTTAATGACGGTAAAGAGATGACACGGACAGCAGGAACAGGAAATCTGCGTCAAGCAATTGCTGGCATTTATG
GACTGACAACAGCCAAAAAAATGATTGAAATTTTAGCATCTGATTTGGATTTTGAAGTATCAGGCTATATTAGTTTGCCA
GAATTAACAAGGGCTAATCGGAATTACATTACTATCCTCATCAATGGTCGCTACATCAAGAATTTCCTACTCAATCGAGC
TATTTTAGATGGATATGGTAGCAAGCTCATGGTGGGACGTTTTCCGATTGCTGTGATTGATATTCGGATTGACCCATATC
TTGCTGATGTCAATGTTCACCCGACCAAGCAAGAAGTGCGGATTTCAAAGGAGCGAGAGCTCATGGTCTTGATATCGCAA
GCTATTGCTGCAAGTTTGAAAGAGCAAGATTTGATTCCGGACGCATTAGAGAATTTAGCCAAATCAACCATTAACCGAGC
AATTAAGCCTGAACAGACCAGCCTCCCTCTCAAAGAGAACCGACTTTATTACGATAAAGAAAGAAATGACTTCTTTGTGA
AACCACAAGTGTCAGAAGCTCAACCTTCTTTTGAGGAATCTGCCCGATTAGACCAACAATCTGCTGATACAGATGAACTC
AATTCAAAAGCTGCTTCTGTCAAATTTGCAGAAAGGCAATCTCCTTCTTACAATCAACTAGATCATCCAGAGCTGGATCA
GGCGAGCTTAGAGAGAGCTTTAGATAAGCTAAATGGAGAAGAAACTTCAACGTTTCCAGAATTGGAATATTTCGGGCAAA
TGCACGGCACCTACCTTTTTGCTCAAGGAAACGGTGGCCTTTATATTATTGACCAACATGCAGCTCAAGAGCGAGTAAAG
TACGAATATTACCGTGAAAAAATCGGAGATGTAGATGCTAGTCAGCAGCAGCTTCTGGTTCCCTATATCTTTGAATTTCC
AGCTGATGATATGTTGCGTCTGAAACAACGAATGACTCTTTTAGAAGAAGTCGGTGTTTTCCTTGAAGAATACGGAACTA
ATCAATTTATTCTTCGTGAACATCCCATTTGGCTTAAGGAAGAGGAGATCGAATCAGGTATTTATGAGATGTGCGATATG
CTGCTTCTAACCAAGGAAGTCTCTATCAAGAAATATCGCGCTGAGCTGGCTATTATGATGAGTTGCAAACGCTCTATTAA
AGCCAATCACAGTTTAGATGACTATTCAGCGCGTGATTTGATTTTTCAGTTATCACAATGCGACAATCCCTACAACTGCC
CTCACGGTCGTCCCGTTTTGGTCAACTTCACCAAATCTGATATGGGAAAAATGTTCCGTCGGATTCAGGAAAACCATACT
AGCCTGAGAGAATTGGGCAAGTATTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| hexB | Streptococcus pneumoniae R6 |
77.042 |
100 |
0.772 |