Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   GQ677_RS01000 Genome accession   NZ_CP047120
Coordinates   158967..161522 (+) Length   851 a.a.
NCBI ID   WP_029714114.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain 1085     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 153967..166522
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GQ677_RS00970 (GQ677_00970) - 153997..154875 (+) 879 WP_002991372.1 YitT family protein -
  GQ677_RS00975 (GQ677_00975) - 154918..155790 (+) 873 WP_002982164.1 YitT family protein -
  GQ677_RS00980 (GQ677_00980) - 155817..156125 (-) 309 WP_002991370.1 bacteriocin immunity protein -
  GQ677_RS00985 (GQ677_00985) argS 156213..157904 (-) 1692 WP_111676884.1 arginine--tRNA ligase -
  GQ677_RS00990 (GQ677_00990) argR 158195..158632 (+) 438 WP_002982171.1 arginine repressor -
  GQ677_RS10290 (GQ677_00995) - 158756..158980 (+) 225 WP_373560700.1 YlbF family regulator -
  GQ677_RS01000 (GQ677_01000) hexA 158967..161522 (+) 2556 WP_029714114.1 DNA mismatch repair protein MutS Machinery gene
  GQ677_RS01005 (GQ677_01005) hexB 161651..163633 (+) 1983 WP_159330786.1 DNA mismatch repair endonuclease MutL Machinery gene
  GQ677_RS01010 (GQ677_01010) - 163644..164864 (+) 1221 WP_010922756.1 MFS transporter -
  GQ677_RS01015 (GQ677_01015) ruvA 164866..165462 (+) 597 WP_002992186.1 Holliday junction branch migration protein RuvA Machinery gene
  GQ677_RS01020 (GQ677_01020) - 165472..166032 (+) 561 WP_010922755.1 DNA-3-methyladenine glycosylase I -

Sequence


Protein


Download         Length: 851 a.a.        Molecular weight: 95485.05 Da        Isoelectric Point: 4.9837

>NTDB_id=357274 GQ677_RS01000 WP_029714114.1 158967..161522(+) (hexA) [Streptococcus pyogenes strain 1085]
MAKTNISPGMQQYLDIKKDYPDAFLLFRMGDFYELFYEDAVKAAQLLEIGLTSRNKNAENPIPMAGVPHHSAQQYIDVLI
ELGYKVAVAEQMEDPKQAVGVVKREVVQVITPGTVVDSAKPDSANNFLVAVDFDGCRYGLAYMDVSTGEFCVTDLADFTS
VRSEIQNLKAKEVLLGFDLSEEEQTILVKQMNLLLSYEETVYEDKSLIDGQLTTVELTAAGKLLQYVHKTQMRELSHLQA
LVHYEIKDYLQMSYATKSSLDLVENARTNKKHGSLYWLLDETKTAMGMRLLRSWIDRPLVSKEAILERQEIIQVFLNAFI
ERTDLSNSLKGVYDIERLSSRVSFGKANPKDLLQLGHTLAQVPYIKAILESFDSPCVDKLVNDIDSLPELEYLIRTAIDP
DAPATISEGSIIRNGFDERLDHYRKVMREGTGWIADIEAKERQASGINNLKIDYNKKDGYYFHVTNSNLSLVPEHFFRKA
TLKNSERYGTAELAKIEGQMLEAREESSSLEYDIFMCIRAQVETYINRLQKLAKILATVDVLQSLAVVAETNHYIRPQFN
DNHVITIQEGRHAVVEKVMGVQEYIPNSISFDQQTSIQLITGPNMSGKSTYMRQLALTVIMAQMGSFVAADHVDLPLFDA
IFTRIGAADDLISGQSTFMVEMMEANQAIKRASDNSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTIFATHYHEL
TDLSTKLTSLVNVHVATLEKDGDVTFLHKIAEGPADKSYGIHVAKIAGLPKSLLKRADEVLTRLETQSRSTEIISVPSQV
ESSSAVRQGQLSLFGDEEKAHEIRQALEVIDVMNMTPLQAMTTLYELKKLL

Nucleotide


Download         Length: 2556 bp        

>NTDB_id=357274 GQ677_RS01000 WP_029714114.1 158967..161522(+) (hexA) [Streptococcus pyogenes strain 1085]
ATGGCAAAAACTAACATTTCTCCTGGAATGCAACAGTATCTGGACATCAAAAAAGATTATCCAGATGCTTTTTTGCTTTT
TAGGATGGGTGACTTTTATGAATTATTTTACGAGGACGCTGTCAAAGCAGCCCAACTCTTAGAAATTGGTTTGACCAGTC
GCAACAAGAATGCGGAAAATCCAATTCCTATGGCAGGCGTGCCACATCATTCTGCCCAACAATACATTGATGTGTTAATT
GAGTTGGGTTACAAGGTTGCTGTCGCAGAACAAATGGAAGACCCAAAGCAAGCTGTTGGGGTGGTGAAGCGTGAGGTCGT
TCAAGTCATAACTCCTGGAACGGTTGTGGATTCAGCTAAGCCAGATAGCGCCAATAACTTTTTGGTAGCTGTTGACTTTG
ATGGTTGCCGTTATGGATTGGCTTATATGGATGTGTCCACAGGTGAATTTTGCGTGACAGATTTGGCGGACTTTACGAGT
GTTCGTAGCGAAATCCAAAACCTCAAGGCAAAAGAAGTCTTACTAGGTTTTGATTTATCTGAAGAAGAACAGACGATTTT
GGTCAAGCAGATGAATTTGCTGCTTTCTTATGAAGAAACGGTCTATGAAGATAAATCTTTAATTGACGGCCAATTGACAA
CGGTAGAACTGACAGCGGCAGGAAAACTCTTGCAATACGTTCACAAAACACAAATGCGAGAACTCAGCCACTTGCAAGCA
TTGGTTCACTATGAGATCAAGGATTATTTGCAGATGTCGTATGCCACTAAGTCAAGTTTAGATTTGGTAGAAAATGCTAG
GACTAATAAAAAACATGGAAGTCTCTATTGGCTGTTAGATGAAACCAAGACAGCTATGGGGATGAGGCTTTTGCGCTCAT
GGATTGATCGACCTTTGGTTTCTAAAGAAGCTATTTTAGAGCGTCAAGAAATTATTCAAGTTTTTCTGAATGCTTTTATT
GAGCGAACCGATTTAAGCAATAGTTTAAAAGGTGTTTACGACATCGAACGCTTATCTAGTCGCGTGTCTTTTGGCAAGGC
AAATCCGAAAGATTTACTTCAATTGGGGCATACCTTAGCTCAAGTGCCTTATATCAAAGCTATCTTAGAGTCTTTTGACA
GTCCTTGTGTTGACAAACTTGTCAATGATATTGACAGTTTGCCTGAGTTGGAATACTTGATTAGAACAGCCATTGATCCA
GATGCACCAGCAACTATTAGTGAAGGAAGTATTATCCGCAATGGTTTTGATGAGCGCTTGGACCATTATCGTAAAGTAAT
GCGAGAGGGGACAGGCTGGATTGCGGATATTGAGGCCAAAGAGCGTCAAGCAAGTGGCATTAATAACCTAAAAATTGATT
ACAATAAAAAAGATGGTTATTATTTTCACGTTACGAATTCAAATCTTAGCTTAGTTCCCGAGCATTTTTTCAGAAAGGCA
ACTTTAAAAAATTCTGAACGTTATGGAACAGCAGAATTGGCTAAGATTGAAGGTCAGATGTTAGAGGCTAGGGAAGAGTC
ATCTAGTTTAGAATACGATATTTTTATGTGTATTCGAGCTCAAGTTGAAACCTATATTAATCGTTTACAGAAACTGGCTA
AAATTTTGGCAACGGTAGATGTTTTGCAAAGTTTAGCAGTCGTTGCTGAAACCAATCATTATATCCGGCCGCAGTTCAAT
GATAATCATGTGATTACAATTCAAGAAGGTCGTCACGCGGTTGTTGAAAAGGTTATGGGAGTGCAGGAATACATTCCCAA
TAGTATCTCTTTTGACCAACAGACCAGTATTCAGCTGATTACAGGTCCAAATATGAGTGGTAAGTCGACTTATATGAGAC
AGCTGGCCTTAACGGTTATCATGGCCCAGATGGGTTCATTTGTGGCTGCTGATCATGTTGATTTACCTTTATTTGATGCG
ATTTTTACGCGTATTGGGGCTGCTGATGATTTGATTTCTGGGCAATCAACCTTTATGGTGGAGATGATGGAAGCAAACCA
AGCAATCAAACGCGCAAGTGACAACTCTCTTATTCTATTTGATGAACTGGGACGAGGCACGGCAACTTATGATGGTATGG
CTTTAGCCCAGGCAATTATTGAATATATCCATGATAGAGTTGGTGCTAAGACCATATTTGCAACGCATTATCATGAATTG
ACAGACTTGTCAACTAAGTTGACAAGTCTAGTCAATGTTCATGTAGCAACGCTTGAAAAAGATGGCGATGTTACCTTCCT
TCATAAGATTGCTGAGGGACCGGCGGATAAATCTTACGGTATTCATGTGGCAAAAATAGCAGGACTGCCAAAATCCCTAT
TAAAGAGAGCAGACGAAGTTCTGACCCGTTTAGAAACACAGTCACGATCTACTGAGATAATATCAGTCCCTTCACAAGTT
GAGTCAAGCAGCGCTGTTAGACAGGGGCAATTATCCCTTTTTGGTGATGAAGAGAAAGCTCATGAGATTAGGCAAGCACT
GGAAGTTATTGATGTCATGAACATGACCCCGCTTCAAGCAATGACAACTCTTTACGAATTGAAAAAGTTGTTATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

71.445

100

0.714

  mutS Pseudomonas stutzeri strain ATCC 17587

37.266

100

0.375