Detailed information
Overview
| Name | hexB | Type | Machinery gene |
| Locus tag | C1A39_RS00335 | Genome accession | NZ_CP028896 |
| Coordinates | 58238..60181 (+) | Length | 647 a.a. |
| NCBI ID | WP_014607839.1 | Uniprot ID | - |
| Organism | Streptococcus thermophilus strain CS5 | ||
| Function | DNA mismatch repair (predicted from homology) Homologous recombination |
||
Genomic Context
Location: 53238..65181
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| C1A39_RS00305 (C1A39_00305) | argR | 53442..53870 (+) | 429 | WP_024704313.1 | arginine repressor | - |
| C1A39_RS00310 (C1A39_00310) | - | 53870..54229 (+) | 360 | WP_011225277.1 | YlbF family regulator | - |
| C1A39_RS00315 (C1A39_00315) | hexA | 54222..56780 (+) | 2559 | WP_014607836.1 | DNA mismatch repair protein MutS | Machinery gene |
| C1A39_RS10225 (C1A39_00320) | - | 56814..57269 (-) | 456 | Protein_44 | DUF3021 domain-containing protein | - |
| C1A39_RS00325 (C1A39_00325) | - | 57266..57657 (-) | 392 | Protein_45 | LytTR family DNA-binding domain-containing protein | - |
| C1A39_RS00330 (C1A39_00330) | - | 57881..58186 (+) | 306 | WP_002949050.1 | hypothetical protein | - |
| C1A39_RS00335 (C1A39_00335) | hexB | 58238..60181 (+) | 1944 | WP_014607839.1 | DNA mismatch repair endonuclease MutL | Machinery gene |
| C1A39_RS00340 (C1A39_00340) | - | 60311..60532 (+) | 222 | WP_011680602.1 | hypothetical protein | - |
| C1A39_RS00345 (C1A39_00345) | ruvA | 60684..61274 (+) | 591 | WP_011680603.1 | Holliday junction branch migration protein RuvA | Machinery gene |
| C1A39_RS00350 (C1A39_00350) | - | 61281..61835 (+) | 555 | WP_011680604.1 | DNA-3-methyladenine glycosylase I | - |
| C1A39_RS00355 (C1A39_00355) | cinA | 61931..63202 (+) | 1272 | WP_011680605.1 | competence/damage-inducible protein A | Machinery gene |
| C1A39_RS00360 (C1A39_00360) | recA | 63238..64377 (+) | 1140 | WP_011680606.1 | recombinase RecA | Machinery gene |
| C1A39_RS00365 (C1A39_00365) | spx | 64554..64952 (+) | 399 | WP_002949058.1 | transcriptional regulator Spx | - |
Sequence
Protein
Download Length: 647 a.a. Molecular weight: 72531.80 Da Isoelectric Point: 5.9934
>NTDB_id=248994 C1A39_RS00335 WP_014607839.1 58238..60181(+) (hexB) [Streptococcus thermophilus strain CS5]
MPKIIELPEVLANQIAAGEVVERPASVVKELVENAIDAGSTQITIEVEESGLSKIQITDNGEGMAQADVAMSLRRHATSK
IKNQGDLFRIRTLGFRGEALPSIASISHLTIVTAADGEVYGTKLVAKGGEIESQDPISTPVGTKITVENLFYNTPARLKY
MKSLQAELAHIVDVVNRLSLAHPEVAFTLLNDGRQLTQTSGTGDLRQAIAGIYGLTTAKKMVEISNSDLDFEVSGYVSLP
ELTRANRNYITILINGRYIKNFLLNRAIFDGYGSKLMVGRFPIAVIDIQIDPYLADVNVHPTKQEVRISKEKELMALIKS
AIAQSLREQDLIPDALENLAKSSTRGATRSVQTSLPLKQTNLYYDSNRNDFFVTPETVQEDIKPLVSKSESSVSLVANKQ
QPTVKQAKRSADDSDSEHGKLDYKNKSKLKRMLENLTNEETSTFPELEFFGQMHGTYLFAQGQGGLYIIDQHAAQERVKY
EYYREKIGVVDSSLQQLLVPYLFEFSGSDYISLQEKMPLLNQVCIYLEPYGNNTFILREHPIWMKEEEIESAVYEMCDML
LLTNEVSVKTYRAELAIMMSCKRSIKANHALDDYSARDLLVQLAQCKNPYNCPHGRPVLVNFTKSDMEKMFRRIQENHTS
LRDLGKY
MPKIIELPEVLANQIAAGEVVERPASVVKELVENAIDAGSTQITIEVEESGLSKIQITDNGEGMAQADVAMSLRRHATSK
IKNQGDLFRIRTLGFRGEALPSIASISHLTIVTAADGEVYGTKLVAKGGEIESQDPISTPVGTKITVENLFYNTPARLKY
MKSLQAELAHIVDVVNRLSLAHPEVAFTLLNDGRQLTQTSGTGDLRQAIAGIYGLTTAKKMVEISNSDLDFEVSGYVSLP
ELTRANRNYITILINGRYIKNFLLNRAIFDGYGSKLMVGRFPIAVIDIQIDPYLADVNVHPTKQEVRISKEKELMALIKS
AIAQSLREQDLIPDALENLAKSSTRGATRSVQTSLPLKQTNLYYDSNRNDFFVTPETVQEDIKPLVSKSESSVSLVANKQ
QPTVKQAKRSADDSDSEHGKLDYKNKSKLKRMLENLTNEETSTFPELEFFGQMHGTYLFAQGQGGLYIIDQHAAQERVKY
EYYREKIGVVDSSLQQLLVPYLFEFSGSDYISLQEKMPLLNQVCIYLEPYGNNTFILREHPIWMKEEEIESAVYEMCDML
LLTNEVSVKTYRAELAIMMSCKRSIKANHALDDYSARDLLVQLAQCKNPYNCPHGRPVLVNFTKSDMEKMFRRIQENHTS
LRDLGKY
Nucleotide
Download Length: 1944 bp
>NTDB_id=248994 C1A39_RS00335 WP_014607839.1 58238..60181(+) (hexB) [Streptococcus thermophilus strain CS5]
ATGCCAAAAATTATCGAATTGCCTGAAGTTCTAGCCAATCAGATTGCTGCTGGTGAGGTCGTAGAGCGACCAGCTAGTGT
AGTTAAAGAGCTGGTGGAAAATGCTATTGATGCAGGCAGCACCCAGATTACTATTGAAGTTGAAGAATCAGGCCTCTCAA
AAATTCAAATCACAGACAATGGCGAAGGAATGGCTCAAGCTGATGTAGCTATGAGTTTGCGCCGTCATGCAACGAGTAAA
ATCAAAAATCAAGGAGATCTCTTTCGTATTCGAACACTTGGTTTTCGAGGTGAAGCCCTACCCTCTATAGCTTCTATTAG
TCACCTTACCATTGTGACAGCAGCGGATGGAGAAGTCTATGGGACCAAGCTTGTTGCTAAAGGTGGAGAAATTGAGAGTC
AAGATCCTATTTCAACCCCAGTGGGAACAAAGATTACAGTTGAAAACTTGTTTTATAACACCCCAGCTCGTCTCAAGTAT
ATGAAGAGTTTACAGGCTGAGTTGGCTCATATTGTCGATGTTGTCAACCGTTTGAGTTTAGCCCACCCCGAAGTAGCCTT
CACCTTGCTTAATGACGGTCGTCAGTTGACACAGACATCAGGTACTGGAGACCTTCGCCAAGCTATTGCAGGGATTTATG
GCTTAACAACAGCAAAAAAAATGGTGGAAATTTCAAATTCCGACCTTGATTTTGAAGTTTCTGGTTATGTCAGTCTCCCT
GAATTAACGCGTGCTAACCGTAACTACATCACGATTCTCATTAACGGACGCTATATAAAAAACTTCCTCCTTAACCGTGC
TATTTTTGATGGTTATGGTTCTAAACTTATGGTGGGACGCTTCCCAATTGCAGTTATTGATATTCAGATTGATCCTTATT
TGGCAGATGTCAATGTTCACCCAACAAAGCAAGAAGTACGTATCTCTAAAGAAAAGGAGCTCATGGCCCTTATCAAATCT
GCCATTGCTCAAAGCCTTAGAGAGCAGGATTTGATTCCTGATGCCCTTGAAAATCTAGCAAAGTCAAGTACTAGAGGTGC
AACTAGGTCAGTTCAGACGAGTCTCCCACTCAAACAAACCAATCTTTACTATGACAGTAACCGTAATGATTTCTTTGTCA
CGCCAGAGACAGTTCAAGAGGATATCAAACCTCTTGTATCAAAGTCAGAGTCTTCAGTTTCATTGGTAGCAAACAAACAG
CAACCTACTGTTAAACAGGCAAAACGTTCAGCAGATGATAGTGATAGCGAACACGGAAAACTTGACTATAAAAATAAATC
GAAATTGAAGCGCATGCTTGAAAATCTGACCAATGAGGAAACATCAACCTTTCCTGAATTGGAGTTCTTTGGTCAAATGC
ATGGAACCTACCTCTTTGCCCAAGGACAAGGTGGCCTTTACATCATTGACCAGCATGCTGCCCAAGAACGTGTCAAGTAT
GAGTACTATCGCGAAAAGATAGGTGTGGTTGATAGTAGTTTACAACAACTTTTGGTTCCCTATCTTTTTGAATTTTCAGG
TTCAGATTACATTAGTTTACAAGAAAAAATGCCTCTTCTTAACCAAGTTTGCATCTATTTGGAGCCTTATGGGAATAATA
CCTTCATTCTTCGAGAGCACCCTATCTGGATGAAGGAAGAAGAAATCGAATCTGCAGTCTATGAGATGTGTGATATGCTT
CTTTTGACGAACGAAGTATCCGTCAAGACCTATCGTGCTGAGTTAGCCATCATGATGAGTTGTAAACGTTCAATAAAGGC
CAATCATGCTCTTGATGATTACTCTGCGCGTGACCTTCTAGTACAGCTTGCACAGTGCAAAAATCCCTATAATTGTCCTC
ACGGCCGTCCAGTACTTGTCAACTTTACCAAGTCTGATATGGAAAAAATGTTCCGTCGTATTCAAGAAAACCATACCAGC
CTACGTGATTTAGGAAAGTATTAA
ATGCCAAAAATTATCGAATTGCCTGAAGTTCTAGCCAATCAGATTGCTGCTGGTGAGGTCGTAGAGCGACCAGCTAGTGT
AGTTAAAGAGCTGGTGGAAAATGCTATTGATGCAGGCAGCACCCAGATTACTATTGAAGTTGAAGAATCAGGCCTCTCAA
AAATTCAAATCACAGACAATGGCGAAGGAATGGCTCAAGCTGATGTAGCTATGAGTTTGCGCCGTCATGCAACGAGTAAA
ATCAAAAATCAAGGAGATCTCTTTCGTATTCGAACACTTGGTTTTCGAGGTGAAGCCCTACCCTCTATAGCTTCTATTAG
TCACCTTACCATTGTGACAGCAGCGGATGGAGAAGTCTATGGGACCAAGCTTGTTGCTAAAGGTGGAGAAATTGAGAGTC
AAGATCCTATTTCAACCCCAGTGGGAACAAAGATTACAGTTGAAAACTTGTTTTATAACACCCCAGCTCGTCTCAAGTAT
ATGAAGAGTTTACAGGCTGAGTTGGCTCATATTGTCGATGTTGTCAACCGTTTGAGTTTAGCCCACCCCGAAGTAGCCTT
CACCTTGCTTAATGACGGTCGTCAGTTGACACAGACATCAGGTACTGGAGACCTTCGCCAAGCTATTGCAGGGATTTATG
GCTTAACAACAGCAAAAAAAATGGTGGAAATTTCAAATTCCGACCTTGATTTTGAAGTTTCTGGTTATGTCAGTCTCCCT
GAATTAACGCGTGCTAACCGTAACTACATCACGATTCTCATTAACGGACGCTATATAAAAAACTTCCTCCTTAACCGTGC
TATTTTTGATGGTTATGGTTCTAAACTTATGGTGGGACGCTTCCCAATTGCAGTTATTGATATTCAGATTGATCCTTATT
TGGCAGATGTCAATGTTCACCCAACAAAGCAAGAAGTACGTATCTCTAAAGAAAAGGAGCTCATGGCCCTTATCAAATCT
GCCATTGCTCAAAGCCTTAGAGAGCAGGATTTGATTCCTGATGCCCTTGAAAATCTAGCAAAGTCAAGTACTAGAGGTGC
AACTAGGTCAGTTCAGACGAGTCTCCCACTCAAACAAACCAATCTTTACTATGACAGTAACCGTAATGATTTCTTTGTCA
CGCCAGAGACAGTTCAAGAGGATATCAAACCTCTTGTATCAAAGTCAGAGTCTTCAGTTTCATTGGTAGCAAACAAACAG
CAACCTACTGTTAAACAGGCAAAACGTTCAGCAGATGATAGTGATAGCGAACACGGAAAACTTGACTATAAAAATAAATC
GAAATTGAAGCGCATGCTTGAAAATCTGACCAATGAGGAAACATCAACCTTTCCTGAATTGGAGTTCTTTGGTCAAATGC
ATGGAACCTACCTCTTTGCCCAAGGACAAGGTGGCCTTTACATCATTGACCAGCATGCTGCCCAAGAACGTGTCAAGTAT
GAGTACTATCGCGAAAAGATAGGTGTGGTTGATAGTAGTTTACAACAACTTTTGGTTCCCTATCTTTTTGAATTTTCAGG
TTCAGATTACATTAGTTTACAAGAAAAAATGCCTCTTCTTAACCAAGTTTGCATCTATTTGGAGCCTTATGGGAATAATA
CCTTCATTCTTCGAGAGCACCCTATCTGGATGAAGGAAGAAGAAATCGAATCTGCAGTCTATGAGATGTGTGATATGCTT
CTTTTGACGAACGAAGTATCCGTCAAGACCTATCGTGCTGAGTTAGCCATCATGATGAGTTGTAAACGTTCAATAAAGGC
CAATCATGCTCTTGATGATTACTCTGCGCGTGACCTTCTAGTACAGCTTGCACAGTGCAAAAATCCCTATAATTGTCCTC
ACGGCCGTCCAGTACTTGTCAACTTTACCAAGTCTGATATGGAAAAAATGTTCCGTCGTATTCAAGAAAACCATACCAGC
CTACGTGATTTAGGAAAGTATTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| hexB | Streptococcus pneumoniae R6 |
69.419 |
100 |
0.702 |