Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   G8B42_RS08935 Genome accession   NZ_CP049690
Coordinates   1806272..1808827 (-) Length   851 a.a.
NCBI ID   WP_011529121.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain ABC208     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1801272..1813827
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  G8B42_RS08890 (G8B42_08970) - 1801658..1802305 (-) 648 WP_011529101.1 helix-turn-helix transcriptional regulator -
  G8B42_RS08895 (G8B42_08975) - 1802471..1802668 (+) 198 WP_011529102.1 helix-turn-helix transcriptional regulator -
  G8B42_RS08900 (G8B42_08980) - 1802682..1803296 (+) 615 WP_021299093.1 Bro-N domain-containing protein -
  G8B42_RS08905 (G8B42_08985) - 1803323..1803559 (+) 237 Protein_1704 phage antirepressor protein -
  G8B42_RS08910 (G8B42_08990) - 1803751..1804164 (+) 414 WP_012560493.1 DUF1492 domain-containing protein -
  G8B42_RS08915 (G8B42_08995) - 1804239..1804439 (+) 201 WP_011529120.1 hypothetical protein -
  G8B42_RS08920 (G8B42_09000) - 1804506..1804700 (+) 195 Protein_1707 DUF1492 domain-containing protein -
  G8B42_RS08925 (G8B42_09005) - 1804675..1805058 (+) 384 WP_011285285.1 ArpU family phage packaging/lysis transcriptional regulator -
  G8B42_RS08930 (G8B42_09010) - 1805259..1805876 (+) 618 WP_021340716.1 hypothetical protein -
  G8B42_RS08935 (G8B42_09015) hexA 1806272..1808827 (-) 2556 WP_011529121.1 DNA mismatch repair protein MutS Machinery gene
  G8B42_RS09495 (G8B42_09020) - 1808814..1809166 (-) 353 Protein_1711 YlbF family regulator -
  G8B42_RS08945 (G8B42_09025) argR 1809163..1809600 (-) 438 WP_002982171.1 arginine repressor -
  G8B42_RS08950 (G8B42_09030) argS 1809891..1811582 (+) 1692 WP_011529123.1 arginine--tRNA ligase -
  G8B42_RS08955 (G8B42_09035) - 1811670..1811978 (+) 309 WP_012561077.1 bacteriocin immunity protein -
  G8B42_RS08960 (G8B42_09040) - 1812005..1812877 (-) 873 WP_011529124.1 YitT family protein -
  G8B42_RS08965 (G8B42_09045) - 1812920..1813798 (-) 879 WP_021299113.1 YitT family protein -

Sequence


Protein


Download         Length: 851 a.a.        Molecular weight: 95518.08 Da        Isoelectric Point: 5.0199

>NTDB_id=374538 G8B42_RS08935 WP_011529121.1 1806272..1808827(-) (hexA) [Streptococcus pyogenes strain ABC208]
MAKTNISPGMQQYLDIKKDYPDAFLLFRMGDFYELFYEDAVKAAQLLEIGLTSRNKNAENPIPMAGVPHHSAQQYIDVLI
ELGYKVAVAEQMEDPKQAVGVVKREVVQVITPGTVVDSAKPDSANNFLVAIDFDGCRYGLAYMDVSTGEFCVTDLADFTS
VRSEIQNLKAKEVLLGFDLSEEEQTILVKQMNLLLSYEETVYEDKSLIDGQLTTVELTAAGKLLQYVHKTQMRELSHLQA
LVHYEIKDYLQMSYATKSSLDLVENARTNKKHGSLYWLLDETKTAMGMRLLRSWIDRPLVSKEAILERQEIIQVFLNAFI
ERTDLSNSLKGVYDIERLSSRVSFGKANPKDLLQLGHTLAQVPYIKAILESFNSAYVDKLVNDIDSLPELEYLIRTAIDP
DAPATISEGSIIRNGFDERLDHYRKVMREGTGWIADIEAKERQASGINNLKIDYNKKDGYYFHVTNSNLSLVPDHFFRKA
TLKNSERYGTAELAKIEGQMLEAREESSSLEYDIFMCIRAQVETYINRLQKLAKILATVDVLQSLAVVAETNHYIRPQFN
DNHVITIQEGRHAVVEKVMGVQEYIPNSISFDQQTSIQLITGPNMSGKSTYMRQLALTVIMAQMGSFVAADHVDLPLFDA
IFTRIGAADDLISGQSTFMVEMMEANQAIKRASDNSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTIFATHYHEL
TDLSTKLTSLVNVHVATLEKDGDVTFLHKIAEGPADKSYGIHVAKIAGLPKSLLKRADEVLTRLETQSRSTEIMSVPPQV
ESSSAVRQGQLSLFGDEEKAHEIRQALEAIDVMNMTPLQAMTTLYELKKLL

Nucleotide


Download         Length: 2556 bp        

>NTDB_id=374538 G8B42_RS08935 WP_011529121.1 1806272..1808827(-) (hexA) [Streptococcus pyogenes strain ABC208]
ATGGCAAAAACTAACATTTCTCCTGGAATGCAACAGTATCTGGACATCAAAAAAGATTATCCAGATGCTTTTTTGCTTTT
TAGGATGGGTGACTTTTATGAATTATTTTACGAGGACGCTGTCAAAGCAGCACAACTCTTAGAAATTGGTTTGACCAGTC
GCAACAAGAATGCGGAAAATCCAATTCCCATGGCAGGCGTGCCACATCATTCTGCCCAACAATACATTGATGTGTTAATT
GAGTTGGGTTACAAGGTTGCTGTCGCAGAACAAATGGAAGACCCAAAGCAAGCTGTTGGGGTGGTGAAGCGTGAGGTCGT
TCAAGTCATAACTCCTGGAACGGTTGTGGATTCAGCTAAGCCAGATAGCGCCAATAACTTTTTGGTAGCTATTGACTTTG
ATGGTTGCCGTTATGGATTGGCTTATATGGATGTGTCCACAGGTGAATTTTGCGTGACAGATTTGGCGGACTTTACGAGT
GTTCGTAGCGAAATCCAAAACCTCAAGGCAAAAGAAGTCTTACTAGGTTTTGATTTATCTGAAGAAGAACAGACGATTTT
GGTCAAGCAGATGAATTTGCTGCTTTCTTATGAAGAAACGGTCTATGAAGATAAATCTTTAATTGACGGTCAATTGACAA
CGGTAGAACTGACAGCGGCAGGAAAACTCTTGCAATACGTTCACAAAACACAAATGCGAGAACTCAGCCACTTGCAAGCC
TTGGTTCACTATGAAATCAAGGATTATTTGCAGATGTCGTATGCCACTAAGTCAAGTCTAGATTTGGTAGAGAATGCTAG
AACGAATAAAAAACATGGGAGTCTGTATTGGCTGTTAGATGAAACCAAGACAGCTATGGGGATGAGGCTTTTGCGCTCAT
GGATTGATCGACCTTTGGTTTCTAAAGAAGCTATTTTAGAGCGTCAAGAAATTATTCAAGTTTTTCTGAATGCTTTTATT
GAGCGAACAGATTTAAGCAATAGCTTAAAAGGTGTTTACGATATCGAACGCTTATCTAGCCGTGTGTCTTTTGGCAAGGC
AAATCCGAAAGATTTACTTCAATTGGGGCATACCTTAGCCCAAGTGCCTTATATCAAAGCCATATTAGAGTCTTTTAACA
GCGCTTATGTTGACAAACTTGTCAATGATATTGACAGTTTGCCTGAGTTGGAATACTTGATTAGAACAGCCATTGATCCA
GATGCACCAGCAACTATTAGTGAAGGAAGTATTATCCGCAATGGTTTTGATGAGCGCTTGGACCATTATCGTAAAGTAAT
GCGAGAGGGGACAGGCTGGATTGCGGATATTGAGGCCAAAGAGCGTCAAGCAAGTGGCATTAATAACCTAAAAATTGATT
ACAATAAAAAAGATGGTTATTATTTTCACGTTACGAATTCAAATCTTAGCTTAGTTCCCGACCATTTTTTCAGAAAGGCA
ACTTTAAAAAATTCTGAGCGTTATGGAACAGCAGAATTGGCTAAGATTGAAGGTCAGATGTTAGAGGCTAGGGAAGAGTC
ATCTAGTTTAGAATACGATATTTTTATGTGTATTCGAGCTCAAGTTGAAACCTATATTAATCGTTTACAGAAACTGGCTA
AAATTTTGGCAACGGTAGATGTTTTGCAAAGTTTAGCAGTCGTTGCTGAAACCAATCATTATATCCGGCCGCAGTTCAAT
GATAATCATGTGATTACAATTCAAGAAGGTCGTCACGCGGTTGTTGAAAAGGTTATGGGAGTGCAGGAATACATTCCCAA
TAGTATCTCTTTTGACCAACAGACCAGTATTCAGCTGATTACAGGTCCAAATATGAGTGGTAAGTCGACTTATATGAGAC
AGCTGGCCTTAACGGTTATCATGGCCCAGATGGGTTCATTTGTGGCTGCTGACCATGTTGATTTACCTTTATTTGATGCG
ATTTTTACGCGTATTGGGGCTGCTGATGATTTGATTTCTGGGCAATCAACCTTTATGGTGGAGATGATGGAAGCAAACCA
AGCAATCAAACGCGCAAGTGACAACTCTCTTATTCTATTTGATGAACTGGGACGAGGTACGGCAACTTATGATGGTATGG
CTTTAGCCCAGGCAATTATTGAATATATCCATGATAGAGTTGGTGCTAAGACCATATTTGCAACGCATTATCATGAATTG
ACAGACTTGTCAACTAAGTTGACAAGTCTAGTCAATGTTCATGTAGCAACGCTTGAAAAAGATGGCGATGTTACCTTCCT
TCATAAGATTGCTGAGGGACCGGCGGATAAATCTTACGGTATTCATGTTGCAAAAATAGCAGGACTGCCAAAATCCCTAT
TAAAGAGAGCAGACGAAGTTCTGACCCGTTTAGAAACACAGTCACGATCTACTGAGATAATGTCAGTCCCTCCACAAGTT
GAGTCAAGCAGCGCTGTTAGACAGGGGCAATTATCCCTTTTTGGTGATGAAGAGAAAGCTCATGAGATTAGGCAAGCACT
GGAAGCTATTGATGTCATGAATATGACCCCGCTTCAAGCAATGACAACCCTTTACGAATTGAAAAAGTTGTTATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

71.563

100

0.716

  mutS Pseudomonas stutzeri strain ATCC 17587

36.959

100

0.371