Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   ETT59_RS08665 Genome accession   NZ_CP035440
Coordinates   1726361..1728916 (-) Length   851 a.a.
NCBI ID   WP_136267848.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain emm124     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1721361..1733916
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  ETT59_RS08630 (ETT59_08625) - 1722309..1722563 (+) 255 WP_111704873.1 hypothetical protein -
  ETT59_RS08635 (ETT59_08630) - 1722560..1722733 (+) 174 WP_068791229.1 DUF2758 domain-containing protein -
  ETT59_RS09075 - 1722739..1722912 (+) 174 WP_168389151.1 hypothetical protein -
  ETT59_RS08640 (ETT59_08635) - 1722914..1723423 (+) 510 WP_136116370.1 hypothetical protein -
  ETT59_RS08645 (ETT59_08640) - 1723497..1723985 (+) 489 WP_136109573.1 hypothetical protein -
  ETT59_RS08650 (ETT59_08645) - 1724387..1724749 (+) 363 WP_002992136.1 DUF1492 domain-containing protein -
  ETT59_RS08655 (ETT59_08650) - 1724724..1725107 (+) 384 WP_033887760.1 ArpU family phage packaging/lysis transcriptional regulator -
  ETT59_RS08660 (ETT59_08655) - 1725312..1725965 (+) 654 WP_063631412.1 hypothetical protein -
  ETT59_RS08665 (ETT59_08660) hexA 1726361..1728916 (-) 2556 WP_136267848.1 DNA mismatch repair protein MutS Machinery gene
  ETT59_RS09355 (ETT59_08665) - 1728903..1729109 (-) 207 WP_032465308.1 YlbF family regulator -
  ETT59_RS08675 (ETT59_08670) argR 1729252..1729689 (-) 438 WP_002982171.1 arginine repressor -
  ETT59_RS08680 (ETT59_08675) argS 1729980..1731671 (+) 1692 WP_136305970.1 arginine--tRNA ligase -
  ETT59_RS08685 (ETT59_08680) - 1731759..1732067 (+) 309 WP_002991370.1 bacteriocin immunity protein -
  ETT59_RS08690 (ETT59_08685) - 1732094..1732966 (-) 873 WP_023079136.1 YitT family protein -
  ETT59_RS08695 (ETT59_08690) - 1733009..1733887 (-) 879 WP_002991372.1 YitT family protein -

Sequence


Protein


Download         Length: 851 a.a.        Molecular weight: 95297.71 Da        Isoelectric Point: 4.8184

>NTDB_id=302172 ETT59_RS08665 WP_136267848.1 1726361..1728916(-) (hexA) [Streptococcus pyogenes strain emm124]
MAKTNISPGMQQYLDIKKDYPDAFLLFRMGDFYELFYEDAVKAAQLLEIGLTSRNKNAENPIPMAGVPHHSAQQYIDVLI
ELGYKVAVAEQMEDPKQAVGVVKREVVQVITPGTVVDSAKPDSANNFLVAVDFDGCRYGLAYMDVSTGEFCVTDLADFTS
VRSEIQNLKAKEVLLGFDLSEEEQTILVKQMNLLLSYEETVYEDKSLIDGQLTTVELTAAGKLLQYVHKTQMRELSHLQA
LVHYEIKDYLQMSYATKSSLDLVENARTNKKHGSLYWLLDETKTAMGMRLLRSWIDRPLVSKEAILERQEIIQVFLNAFI
ERTDLSNSLKGVYDIERLSSRVSFGKANPKDLLQLGHTLAQVPYIKAILESFDSPCVDKLVNDIDSLPELEYLIRTAIDP
DAPATISEGSIIRNGFDERLDHYRKVMREGTGWIADIEAKERQASGINNLKIDYNKKDGYYFHVTTSNLSLVPEYFFRKA
TLKNSERYGTAELAKIEGQMLEAREESSSLEYDIFMCIRAQVETYINRLQKLAKTLATVDVLQSLAVVAETNHYIRPQFN
DNHVITIQEGRHAVVEKVMGVQEYIPNSISFDQQTSIQLITGPNMSGKSTYMRQLALTVIMAQMGSFVAADHVDLPLFDA
IFTRIGAADDLISGQSTFMVEMMEANQAIKRASDNSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTIFATHYHEL
TDLSTKLTSLVNVHVATLEKDGDVTFLHKIAEGPADKSYGIHVAKIAGLPEALLSRADEVLTRLEAQAQSAEIISVPSQV
ESSSAVRQGQLSLFGDEEKAHEIRQALEAIDVMNMTPLQAMTTLYELKKLL

Nucleotide


Download         Length: 2556 bp        

>NTDB_id=302172 ETT59_RS08665 WP_136267848.1 1726361..1728916(-) (hexA) [Streptococcus pyogenes strain emm124]
ATGGCAAAAACTAACATTTCTCCTGGAATGCAACAGTATCTGGACATCAAAAAAGATTATCCAGATGCTTTTTTGCTTTT
TAGGATGGGTGACTTTTATGAATTATTTTACGAGGACGCTGTCAAAGCAGCACAACTCTTAGAAATTGGTTTGACCAGTC
GCAACAAGAATGCGGAAAATCCAATTCCTATGGCAGGCGTGCCACATCATTCTGCCCAACAATACATTGATGTGTTAATT
GAGTTGGGTTACAAGGTTGCTGTCGCAGAACAAATGGAAGACCCAAAGCAAGCTGTTGGGGTGGTGAAGCGTGAGGTCGT
TCAAGTCATAACTCCTGGAACGGTTGTGGATTCAGCTAAGCCAGATAGCGCCAATAACTTTTTGGTAGCTGTTGACTTTG
ATGGTTGCCGTTATGGATTGGCTTATATGGATGTATCCACAGGTGAATTTTGCGTGACAGATTTGGCGGACTTTACGAGT
GTTCGTAGCGAAATCCAAAACCTCAAGGCAAAAGAAGTCTTACTAGGTTTTGATTTATCTGAAGAAGAACAGACGATTTT
GGTCAAGCAGATGAATTTGCTGCTTTCTTATGAAGAAACGGTCTATGAAGATAAATCTTTAATTGACGGCCAATTGACAA
CGGTAGAACTGACAGCGGCAGGAAAACTCTTGCAATACGTTCACAAAACACAAATGCGAGAACTCAGCCACTTGCAAGCC
TTGGTTCACTATGAGATCAAGGATTATTTGCAGATGTCGTATGCCACTAAGTCAAGTTTAGATTTGGTAGAAAATGCTAG
GACTAATAAAAAACATGGAAGTCTCTATTGGCTGTTAGATGAAACCAAGACAGCTATGGGGATGAGGCTTTTGCGCTCAT
GGATTGATCGACCTTTGGTTTCTAAAGAAGCTATTTTAGAGCGTCAAGAAATTATTCAAGTTTTTCTGAATGCTTTTATT
GAGCGAACCGATTTAAGCAATAGTTTAAAAGGTGTTTACGACATCGAACGCTTATCTAGTCGCGTGTCTTTTGGCAAGGC
AAATCCGAAAGATTTACTTCAATTGGGGCATACCTTAGCTCAAGTGCCTTATATCAAAGCTATCTTAGAGTCTTTTGACA
GTCCTTGTGTTGACAAACTTGTCAATGATATTGACAGTTTGCCTGAGTTGGAATACTTGATTAGAACAGCCATTGATCCA
GATGCACCAGCAACTATTAGTGAAGGAAGTATTATCCGCAATGGTTTTGATGAGCGCTTGGACCATTATCGTAAAGTGAT
GCGAGAGGGGACAGGCTGGATTGCGGATATTGAGGCCAAAGAGCGTCAAGCAAGCGGCATTAATAATCTAAAAATTGATT
ACAATAAAAAAGATGGATATTATTTCCACGTTACGACTTCAAATCTTAGCTTAGTGCCTGAGTATTTTTTCAGAAAGGCA
ACTTTAAAAAATTCTGAACGTTATGGAACAGCAGAATTGGCTAAGATTGAAGGTCAGATGTTAGAGGCTAGGGAAGAGTC
ATCTAGTTTAGAATACGATATTTTTATGTGTATTCGAGCTCAAGTTGAAACCTATATTAATCGTTTACAGAAACTGGCTA
AAACTTTGGCAACGGTGGATGTTTTGCAAAGTTTAGCAGTCGTTGCTGAAACCAATCATTATATTCGGCCGCAGTTCAAT
GATAATCATGTGATTACAATTCAAGAAGGTCGTCACGCCGTTGTTGAAAAGGTTATGGGAGTGCAGGAATACATTCCCAA
TAGTATCTCTTTTGACCAACAGACCAGTATTCAGCTGATTACAGGTCCAAATATGAGTGGTAAGTCGACTTATATGAGAC
AGCTGGCCTTAACGGTTATCATGGCCCAGATGGGTTCATTTGTGGCTGCTGATCATGTTGATTTACCTTTATTTGATGCG
ATTTTTACGCGTATTGGGGCTGCTGATGATTTGATTTCTGGGCAATCAACCTTTATGGTGGAGATGATGGAAGCAAACCA
AGCAATCAAACGCGCAAGTGACAACTCTCTTATTCTATTTGATGAACTGGGACGAGGCACGGCAACTTATGATGGTATGG
CTTTAGCCCAGGCAATTATTGAATATATCCATGATAGAGTTGGTGCTAAGACCATATTTGCAACGCATTATCATGAATTG
ACAGACTTGTCAACTAAGTTGACAAGTCTAGTCAATGTTCATGTAGCAACGCTTGAAAAAGATGGCGATGTTACCTTCCT
TCATAAGATTGCTGAGGGACCGGCGGATAAATCTTACGGTATTCATGTAGCAAAAATAGCAGGACTTCCTGAGGCCCTGC
TAAGCAGAGCAGATGAGGTGCTTACTCGTTTAGAAGCGCAAGCACAATCTGCTGAGATAATATCAGTCCCTTCACAAGTT
GAGTCAAGCAGCGCTGTTAGACAGGGGCAATTATCCCTTTTTGGTGATGAAGAGAAAGCTCATGAGATTAGGCAAGCACT
GGAAGCTATTGATGTCATGAACATGACCCCGCTTCAAGCAATGACAACCCTTTACGAATTGAAAAAGTTGTTATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

71.21

100

0.712

  mutS Pseudomonas stutzeri strain ATCC 17587

37.033

100

0.373