Detailed information
Overview
| Name | hexA | Type | Machinery gene |
| Locus tag | DK181_RS10415 | Genome accession | NZ_CP029490 |
| Coordinates | 2129410..2131971 (-) | Length | 853 a.a. |
| NCBI ID | WP_002960565.1 | Uniprot ID | A0ABN5LPH4 |
| Organism | Streptococcus sobrinus strain SL1 | ||
| Function | DNA mismatch repair (predicted from homology) Homologous recombination |
||
Genomic Context
Location: 2124410..2136971
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| DK181_RS10395 (DK182_10395) | - | 2124699..2125250 (-) | 552 | WP_002960562.1 | DNA-3-methyladenine glycosylase I | - |
| DK181_RS10400 (DK182_10400) | ruvA | 2125419..2126009 (-) | 591 | WP_002960563.1 | Holliday junction branch migration protein RuvA | Machinery gene |
| DK181_RS10405 (DK182_10405) | hexB | 2126241..2128232 (-) | 1992 | WP_002960564.1 | DNA mismatch repair endonuclease MutL | Machinery gene |
| DK181_RS10410 (DK182_10410) | - | 2128413..2129377 (-) | 965 | Protein_1986 | DUF3644 domain-containing protein | - |
| DK181_RS10415 (DK182_10415) | hexA | 2129410..2131971 (-) | 2562 | WP_002960565.1 | DNA mismatch repair protein MutS | Machinery gene |
| DK181_RS10420 (DK182_10420) | - | 2131958..2132311 (-) | 354 | WP_019795383.1 | YlbF family regulator | - |
| DK181_RS10425 (DK182_10425) | argR | 2132304..2132738 (-) | 435 | WP_002960568.1 | arginine repressor | - |
| DK181_RS10430 (DK182_10430) | argS | 2132894..2134585 (+) | 1692 | WP_002960570.1 | arginine--tRNA ligase | - |
| DK181_RS10435 (DK182_10435) | - | 2134798..2135157 (-) | 360 | WP_002960574.1 | hypothetical protein | - |
| DK181_RS10440 (DK182_10440) | - | 2135196..2135423 (-) | 228 | WP_002960575.1 | ComC/BlpC family leader-containing pheromone/bacteriocin | - |
| DK181_RS10445 (DK182_10445) | - | 2135990..2136931 (-) | 942 | WP_002959662.1 | YitT family protein | - |
Sequence
Protein
Download Length: 853 a.a. Molecular weight: 95256.52 Da Isoelectric Point: 4.7979
>NTDB_id=253791 DK181_RS10415 WP_002960565.1 2129410..2131971(-) (hexA) [Streptococcus sobrinus strain SL1]
MAKDKISPGMQQYLDIKESYPDAFLLFRMGDFYELFYDDAVKAAQILEISLTSRNKNADNPIPMAGVPYHSAQQYIDVLV
DLGYKVAIAEQMEDPKKAVGVVKREVVQVITPGTVVDSSKPDSSNNFLVAIDYLNGVYGLSYMDLSTGEFCATSLTDFTA
VRSEIQNLKAKEVVLGFDLSDKQQEALTKQMSLLLSPEKEVYDDVQLIGSDLSSVEAQAAGKLLQYVHQTQKRELSHLQS
LVHYEIKDFLQMTYATKTSLDLLENARTSKKHGSLFWLLDSTKTAMGMRLLRTWIDRPLVSQEKILERQEIVQTFLDNFF
ERSDLTDSLKGVYDIERLASRVSFGKANPKDLLQLGHTLAQVPKIKTILASFSSPVLDRLNEAIDALPELESLIASAIDQ
DAPATITEGGMIKTGFDQQLDHYRQVMREGTTWIAEIEAKERSASGISTLKIDYNRKDGYYFHVTNSNLSLVPDHFFRKA
TLKNSERFGTAELAKIEGDMLEAREQSATLEYDIFMTVRNQVEKYIQRLQDLAKNIATVDALQSLAVVAENNHYVRPQFN
DQQLIDIQEGRHAVVEKVMGTQEYIPNTITLDQKTAIQLITGPNMSGKSTYMRQLALTVVMAQIGSFVAAESANLPIFDA
IYTRIGAADDLISGQSTFMVEMMEANMAIQRASSQSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTLFATHYHEL
TELSISLTHLVNVHVATLEKDGDVTFLHKITDGPADKSYGVHVAKIAGLPEALLQRANAILTDLEAHSVSLTGQEDFTEL
DKLVKQKRDSQQLSLFEVAEPNDKLVQALQDLDVVNMTPMEAMNALFELKKLL
MAKDKISPGMQQYLDIKESYPDAFLLFRMGDFYELFYDDAVKAAQILEISLTSRNKNADNPIPMAGVPYHSAQQYIDVLV
DLGYKVAIAEQMEDPKKAVGVVKREVVQVITPGTVVDSSKPDSSNNFLVAIDYLNGVYGLSYMDLSTGEFCATSLTDFTA
VRSEIQNLKAKEVVLGFDLSDKQQEALTKQMSLLLSPEKEVYDDVQLIGSDLSSVEAQAAGKLLQYVHQTQKRELSHLQS
LVHYEIKDFLQMTYATKTSLDLLENARTSKKHGSLFWLLDSTKTAMGMRLLRTWIDRPLVSQEKILERQEIVQTFLDNFF
ERSDLTDSLKGVYDIERLASRVSFGKANPKDLLQLGHTLAQVPKIKTILASFSSPVLDRLNEAIDALPELESLIASAIDQ
DAPATITEGGMIKTGFDQQLDHYRQVMREGTTWIAEIEAKERSASGISTLKIDYNRKDGYYFHVTNSNLSLVPDHFFRKA
TLKNSERFGTAELAKIEGDMLEAREQSATLEYDIFMTVRNQVEKYIQRLQDLAKNIATVDALQSLAVVAENNHYVRPQFN
DQQLIDIQEGRHAVVEKVMGTQEYIPNTITLDQKTAIQLITGPNMSGKSTYMRQLALTVVMAQIGSFVAAESANLPIFDA
IYTRIGAADDLISGQSTFMVEMMEANMAIQRASSQSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTLFATHYHEL
TELSISLTHLVNVHVATLEKDGDVTFLHKITDGPADKSYGVHVAKIAGLPEALLQRANAILTDLEAHSVSLTGQEDFTEL
DKLVKQKRDSQQLSLFEVAEPNDKLVQALQDLDVVNMTPMEAMNALFELKKLL
Nucleotide
Download Length: 2562 bp
>NTDB_id=253791 DK181_RS10415 WP_002960565.1 2129410..2131971(-) (hexA) [Streptococcus sobrinus strain SL1]
ATGGCAAAAGATAAAATTTCTCCAGGCATGCAGCAGTATTTAGACATCAAAGAATCCTATCCGGATGCTTTTTTGCTTTT
TCGGATGGGGGATTTTTATGAGCTCTTCTACGACGATGCGGTTAAGGCTGCTCAGATTTTGGAAATCAGCCTCACCAGTC
GCAATAAGAATGCTGACAATCCCATTCCTATGGCGGGCGTGCCCTATCATTCAGCACAACAATATATTGATGTCCTAGTC
GATTTGGGTTATAAGGTAGCCATTGCCGAGCAGATGGAGGACCCCAAAAAGGCTGTTGGTGTCGTCAAACGGGAGGTTGT
TCAGGTGATTACGCCAGGAACCGTGGTGGATTCCAGCAAGCCCGATAGCAGTAATAATTTCTTGGTTGCCATCGACTATC
TGAATGGGGTTTACGGACTCTCCTATATGGACCTCTCAACTGGGGAGTTTTGTGCCACCAGCCTGACAGACTTTACAGCC
GTTCGTAGCGAAATTCAAAATCTCAAGGCCAAGGAAGTCGTTCTGGGCTTTGATTTGAGTGACAAGCAGCAGGAAGCTCT
GACCAAGCAGATGAGTCTCCTTTTGTCACCTGAAAAAGAGGTCTATGATGATGTCCAGCTGATTGGCTCTGACTTGTCAA
GCGTAGAGGCCCAGGCCGCTGGTAAGCTCCTCCAATACGTCCATCAGACACAAAAGCGGGAGCTCAGCCACCTACAAAGT
CTGGTTCACTACGAAATCAAGGACTTCCTACAGATGACCTATGCCACCAAGACCAGTCTGGATCTCTTGGAAAATGCTAG
AACCAGCAAGAAACACGGCAGTCTCTTCTGGCTTTTGGATTCAACTAAGACAGCCATGGGGATGCGGCTCTTGCGGACCT
GGATTGATCGGCCCTTGGTTAGCCAAGAGAAAATCTTGGAGCGGCAGGAGATTGTTCAGACCTTCTTGGATAACTTTTTT
GAACGCAGCGACCTGACCGACAGCCTCAAGGGGGTCTACGATATTGAGCGCCTAGCCAGCCGAGTGTCTTTTGGTAAGGC
CAATCCCAAGGACCTCTTGCAGTTGGGGCATACTCTAGCCCAGGTTCCCAAAATCAAGACCATCTTAGCCAGCTTTTCTA
GTCCCGTTTTAGACCGGCTAAATGAAGCCATTGATGCCCTGCCGGAGTTGGAAAGTCTGATTGCCTCGGCCATTGACCAA
GATGCTCCAGCCACCATTACCGAAGGGGGCATGATTAAGACAGGCTTTGACCAGCAGTTGGATCATTATCGCCAGGTGAT
GCGGGAAGGAACCACCTGGATTGCCGAAATCGAAGCCAAGGAGCGATCAGCCAGCGGGATTTCCACCCTCAAGATTGATT
ACAACCGCAAGGATGGTTACTATTTCCATGTGACCAATTCCAATCTTTCCCTAGTGCCGGACCATTTCTTCCGCAAGGCA
ACTCTGAAAAATTCTGAGCGTTTTGGGACAGCGGAACTGGCTAAAATTGAAGGGGACATGCTGGAAGCCAGAGAGCAATC
GGCAACCCTGGAATACGATATTTTCATGACCGTCCGCAATCAGGTGGAAAAATACATCCAACGTCTGCAAGACCTGGCCA
AAAATATTGCAACTGTTGATGCCCTACAGAGCCTAGCCGTTGTGGCTGAAAACAATCACTATGTTCGGCCCCAGTTCAAC
GACCAGCAGCTTATTGATATTCAAGAGGGGCGCCACGCTGTTGTTGAGAAGGTTATGGGAACCCAGGAATACATTCCTAA
TACCATCACCTTGGATCAGAAGACTGCGATTCAGCTGATTACGGGTCCCAATATGAGCGGGAAATCCACTTATATGAGGC
AGTTGGCCCTGACTGTGGTCATGGCTCAAATCGGCTCCTTTGTGGCTGCCGAGTCTGCTAATCTTCCTATTTTTGATGCC
ATCTACACTCGGATTGGGGCAGCCGATGACCTGATTTCCGGGCAATCAACCTTTATGGTTGAGATGATGGAGGCCAATAT
GGCTATCCAGCGGGCTAGCAGTCAGTCCCTTATCCTCTTTGACGAATTGGGCCGAGGCACCGCCACCTATGACGGGATGG
CCCTGGCTCAGGCAATCATCGAATACATTCACGATAGGGTAGGTGCCAAGACCCTCTTTGCCACCCATTATCACGAATTG
ACGGAACTGTCAATCAGCTTGACACATCTGGTCAATGTCCACGTGGCGACTCTGGAGAAGGACGGCGATGTTACCTTCCT
GCATAAGATTACAGATGGTCCTGCTGACAAGTCTTACGGGGTCCATGTGGCCAAGATTGCAGGTTTGCCTGAGGCTCTCC
TCCAGCGAGCCAATGCTATCTTGACTGATTTAGAGGCCCATTCGGTCAGCTTGACCGGCCAAGAAGACTTTACGGAGCTT
GACAAACTTGTCAAACAGAAAAGAGACAGTCAACAGTTGTCCCTCTTTGAAGTAGCAGAACCTAATGATAAGTTGGTTCA
AGCCCTCCAAGACCTTGATGTGGTCAATATGACCCCTATGGAAGCCATGAATGCCCTCTTCGAATTGAAAAAATTATTGT
AA
ATGGCAAAAGATAAAATTTCTCCAGGCATGCAGCAGTATTTAGACATCAAAGAATCCTATCCGGATGCTTTTTTGCTTTT
TCGGATGGGGGATTTTTATGAGCTCTTCTACGACGATGCGGTTAAGGCTGCTCAGATTTTGGAAATCAGCCTCACCAGTC
GCAATAAGAATGCTGACAATCCCATTCCTATGGCGGGCGTGCCCTATCATTCAGCACAACAATATATTGATGTCCTAGTC
GATTTGGGTTATAAGGTAGCCATTGCCGAGCAGATGGAGGACCCCAAAAAGGCTGTTGGTGTCGTCAAACGGGAGGTTGT
TCAGGTGATTACGCCAGGAACCGTGGTGGATTCCAGCAAGCCCGATAGCAGTAATAATTTCTTGGTTGCCATCGACTATC
TGAATGGGGTTTACGGACTCTCCTATATGGACCTCTCAACTGGGGAGTTTTGTGCCACCAGCCTGACAGACTTTACAGCC
GTTCGTAGCGAAATTCAAAATCTCAAGGCCAAGGAAGTCGTTCTGGGCTTTGATTTGAGTGACAAGCAGCAGGAAGCTCT
GACCAAGCAGATGAGTCTCCTTTTGTCACCTGAAAAAGAGGTCTATGATGATGTCCAGCTGATTGGCTCTGACTTGTCAA
GCGTAGAGGCCCAGGCCGCTGGTAAGCTCCTCCAATACGTCCATCAGACACAAAAGCGGGAGCTCAGCCACCTACAAAGT
CTGGTTCACTACGAAATCAAGGACTTCCTACAGATGACCTATGCCACCAAGACCAGTCTGGATCTCTTGGAAAATGCTAG
AACCAGCAAGAAACACGGCAGTCTCTTCTGGCTTTTGGATTCAACTAAGACAGCCATGGGGATGCGGCTCTTGCGGACCT
GGATTGATCGGCCCTTGGTTAGCCAAGAGAAAATCTTGGAGCGGCAGGAGATTGTTCAGACCTTCTTGGATAACTTTTTT
GAACGCAGCGACCTGACCGACAGCCTCAAGGGGGTCTACGATATTGAGCGCCTAGCCAGCCGAGTGTCTTTTGGTAAGGC
CAATCCCAAGGACCTCTTGCAGTTGGGGCATACTCTAGCCCAGGTTCCCAAAATCAAGACCATCTTAGCCAGCTTTTCTA
GTCCCGTTTTAGACCGGCTAAATGAAGCCATTGATGCCCTGCCGGAGTTGGAAAGTCTGATTGCCTCGGCCATTGACCAA
GATGCTCCAGCCACCATTACCGAAGGGGGCATGATTAAGACAGGCTTTGACCAGCAGTTGGATCATTATCGCCAGGTGAT
GCGGGAAGGAACCACCTGGATTGCCGAAATCGAAGCCAAGGAGCGATCAGCCAGCGGGATTTCCACCCTCAAGATTGATT
ACAACCGCAAGGATGGTTACTATTTCCATGTGACCAATTCCAATCTTTCCCTAGTGCCGGACCATTTCTTCCGCAAGGCA
ACTCTGAAAAATTCTGAGCGTTTTGGGACAGCGGAACTGGCTAAAATTGAAGGGGACATGCTGGAAGCCAGAGAGCAATC
GGCAACCCTGGAATACGATATTTTCATGACCGTCCGCAATCAGGTGGAAAAATACATCCAACGTCTGCAAGACCTGGCCA
AAAATATTGCAACTGTTGATGCCCTACAGAGCCTAGCCGTTGTGGCTGAAAACAATCACTATGTTCGGCCCCAGTTCAAC
GACCAGCAGCTTATTGATATTCAAGAGGGGCGCCACGCTGTTGTTGAGAAGGTTATGGGAACCCAGGAATACATTCCTAA
TACCATCACCTTGGATCAGAAGACTGCGATTCAGCTGATTACGGGTCCCAATATGAGCGGGAAATCCACTTATATGAGGC
AGTTGGCCCTGACTGTGGTCATGGCTCAAATCGGCTCCTTTGTGGCTGCCGAGTCTGCTAATCTTCCTATTTTTGATGCC
ATCTACACTCGGATTGGGGCAGCCGATGACCTGATTTCCGGGCAATCAACCTTTATGGTTGAGATGATGGAGGCCAATAT
GGCTATCCAGCGGGCTAGCAGTCAGTCCCTTATCCTCTTTGACGAATTGGGCCGAGGCACCGCCACCTATGACGGGATGG
CCCTGGCTCAGGCAATCATCGAATACATTCACGATAGGGTAGGTGCCAAGACCCTCTTTGCCACCCATTATCACGAATTG
ACGGAACTGTCAATCAGCTTGACACATCTGGTCAATGTCCACGTGGCGACTCTGGAGAAGGACGGCGATGTTACCTTCCT
GCATAAGATTACAGATGGTCCTGCTGACAAGTCTTACGGGGTCCATGTGGCCAAGATTGCAGGTTTGCCTGAGGCTCTCC
TCCAGCGAGCCAATGCTATCTTGACTGATTTAGAGGCCCATTCGGTCAGCTTGACCGGCCAAGAAGACTTTACGGAGCTT
GACAAACTTGTCAAACAGAAAAGAGACAGTCAACAGTTGTCCCTCTTTGAAGTAGCAGAACCTAATGATAAGTTGGTTCA
AGCCCTCCAAGACCTTGATGTGGTCAATATGACCCCTATGGAAGCCATGAATGCCCTCTTCGAATTGAAAAAATTATTGT
AA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| hexA | Streptococcus pneumoniae R6 |
72.014 |
100 |
0.721 |
| mutS | Pseudomonas stutzeri strain ATCC 17587 |
37.212 |
100 |
0.379 |