Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   ACB338_RS09075 Genome accession   NZ_CP167024
Coordinates   1785731..1788286 (-) Length   851 a.a.
NCBI ID   WP_010922773.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain Isolate     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1780731..1793286
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  ACB338_RS09020 (ACB338_09025) - 1780769..1781104 (+) 336 Protein_1717 hypothetical protein -
  ACB338_RS09025 (ACB338_09030) - 1781103..1781336 (+) 234 WP_014407966.1 hypothetical protein -
  ACB338_RS09030 (ACB338_09035) - 1781350..1781508 (+) 159 WP_011285309.1 hypothetical protein -
  ACB338_RS09035 (ACB338_09040) - 1781599..1782387 (+) 789 WP_011285308.1 hypothetical protein -
  ACB338_RS09040 (ACB338_09045) - 1782384..1782650 (+) 267 WP_011285307.1 hypothetical protein -
  ACB338_RS09045 (ACB338_09050) - 1782647..1783030 (+) 384 WP_011285306.1 hypothetical protein -
  ACB338_RS09050 (ACB338_09055) - 1783020..1783295 (+) 276 WP_014407964.1 hypothetical protein -
  ACB338_RS09055 (ACB338_09060) - 1783270..1783515 (+) 246 WP_011285304.1 hypothetical protein -
  ACB338_RS09060 (ACB338_09065) - 1783796..1784158 (+) 363 WP_127821323.1 DUF1492 domain-containing protein -
  ACB338_RS09065 (ACB338_09070) - 1784133..1784516 (+) 384 WP_011285285.1 ArpU family phage packaging/lysis transcriptional regulator -
  ACB338_RS09070 (ACB338_09075) - 1784717..1785334 (+) 618 WP_021340716.1 hypothetical protein -
  ACB338_RS09075 (ACB338_09080) hexA 1785731..1788286 (-) 2556 WP_010922773.1 DNA mismatch repair protein MutS Machinery gene
  ACB338_RS09080 (ACB338_09085) - 1788273..1788479 (-) 207 WP_010922774.1 YlbF family regulator -
  ACB338_RS09085 (ACB338_09090) argR 1788622..1789059 (-) 438 WP_002982171.1 arginine repressor -
  ACB338_RS09090 (ACB338_09095) argS 1789350..1791041 (+) 1692 WP_002991367.1 arginine--tRNA ligase -
  ACB338_RS09095 (ACB338_09100) - 1791129..1791437 (+) 309 WP_002991370.1 bacteriocin immunity protein -
  ACB338_RS09100 (ACB338_09105) - 1791464..1792336 (-) 873 WP_002982164.1 YitT family protein -
  ACB338_RS09105 (ACB338_09110) - 1792379..1793257 (-) 879 WP_002991372.1 YitT family protein -

Sequence


Protein


Download         Length: 851 a.a.        Molecular weight: 95470.98 Da        Isoelectric Point: 4.9457

>NTDB_id=931813 ACB338_RS09075 WP_010922773.1 1785731..1788286(-) (hexA) [Streptococcus pyogenes strain Isolate]
MAKTNISPGMQQYLDIKKDYPDAFLLFRMGDFYELFYEDAVKAAQLLEIGLTSRNKNAENPIPMAGVPHHSAQQYIDVLI
ELGYKVAVAEQMEDPKQAVGVVKREVVQVITPGTVVDSAKPDSANNFLVAVDFDGCRYGLAYMDVSTGEFCVTDLADFTS
VRSEIQNLKAKEVLLGFDLSEEEQTILVKQMNLLLSYEETVYEDKSLIDGQLTTVELTAAGKLLQYVHKTQMRELSHLQA
LVHYEIKDYLQMSYATKSSLDLVENARTNKKHGSLYWLLDETKTAMGMRLLRSWIDRPLVSKEAILERQEIIQVFLNAFI
ERTDLSNSLKGVYDIERLSSRVSFGKANPKDLLQLGHTLAQVPYIKAILESFDSPCVDKLVNDIDSLPELEYLIRTAIDP
DAPATISEGSIIRNGFDERLDHYRKVMREGTGWIADIEAKERQASGINNLKIDYNKKDGYYFHVTNSNLSLVPEHFFRKA
TLKNSERYGTAELAKIEGQMLEAREESSSLEYDIFMCIRAQVETYINRLQKLAKILATVDVLQSLAVVAETNHYIRPQFN
DNHVITIQEGRHAVVEKVMGVQEYIPNSISFDQQTSIQLITGPNMSGKSTYMRQLALTVIMAQMGSFVAADHVDLPLFDA
IFTRIGAADDLISGQSTFMVEMMEANQAIKRASDNSLILFDELGRGTATYDGMALAQAIIEYIHDRVGAKTIFATHYHEL
TDLSTNLTSLVNVHVATLEKDGDVTFLHKIAEGPADKSYGIHVAKIAGLPKSLLKRADEVLTRLETQSRSTEIISVPSQV
ESSSAVRQGQLSLFGDEEKAHEIRQALEVIDVMNMTPLQAMTTLYELKKLL

Nucleotide


Download         Length: 2556 bp        

>NTDB_id=931813 ACB338_RS09075 WP_010922773.1 1785731..1788286(-) (hexA) [Streptococcus pyogenes strain Isolate]
ATGGCAAAAACTAACATTTCTCCTGGAATGCAACAGTATCTGGACATCAAAAAAGATTATCCAGATGCTTTTTTGCTTTT
TAGGATGGGTGACTTTTATGAATTATTTTACGAGGACGCTGTCAAAGCAGCACAACTCTTAGAAATTGGTTTGACCAGTC
GCAACAAGAATGCGGAAAATCCAATTCCTATGGCAGGCGTGCCACATCATTCTGCCCAACAATACATTGATGTGTTAATT
GAGTTGGGTTACAAGGTTGCTGTCGCAGAACAAATGGAAGACCCAAAGCAAGCTGTTGGGGTGGTGAAGCGTGAGGTCGT
TCAAGTCATAACTCCTGGAACGGTTGTGGATTCAGCTAAGCCAGATAGCGCCAATAACTTTTTGGTAGCTGTTGACTTTG
ATGGTTGCCGTTATGGATTGGCTTATATGGATGTATCCACAGGTGAATTTTGCGTGACAGATTTGGCGGACTTTACGAGT
GTTCGTAGCGAAATCCAAAACCTCAAGGCGAAAGAAGTCTTACTAGGTTTTGATTTATCTGAAGAAGAACAGACGATTTT
GGTCAAGCAGATGAATTTGCTGCTTTCTTATGAAGAAACGGTCTATGAAGATAAATCTTTAATTGACGGCCAATTGACAA
CGGTAGAACTGACAGCGGCAGGAAAACTCTTGCAATACGTTCACAAAACACAAATGCGAGAACTCAGCCACTTGCAAGCA
TTGGTTCACTATGAGATCAAGGATTATTTGCAGATGTCGTATGCCACTAAGTCAAGTTTAGATTTGGTAGAAAATGCTAG
GACTAATAAAAAACATGGAAGTCTCTATTGGCTGTTAGATGAAACCAAGACAGCTATGGGGATGAGGCTTTTGCGCTCAT
GGATTGATCGACCTTTGGTTTCTAAAGAAGCTATTTTAGAGCGTCAAGAAATTATTCAAGTTTTTCTGAATGCTTTTATT
GAGCGAACCGATTTAAGCAATAGTTTAAAAGGTGTTTACGACATCGAACGCTTATCTAGTCGCGTGTCTTTTGGCAAGGC
AAATCCGAAAGATTTACTTCAATTGGGGCATACCTTAGCTCAAGTGCCTTATATCAAAGCTATCTTAGAGTCTTTTGACA
GTCCTTGTGTTGACAAACTTGTCAATGATATTGACAGTTTGCCTGAGTTGGAATACTTGATTAGAACAGCCATTGATCCA
GATGCACCAGCAACTATTAGTGAAGGAAGTATTATCCGCAATGGTTTTGATGAGCGCTTGGACCATTATCGTAAAGTAAT
GCGAGAGGGGACAGGCTGGATTGCGGATATTGAGGCCAAAGAGCGTCAAGCAAGTGGCATTAATAACCTAAAAATTGATT
ACAATAAAAAAGATGGTTATTATTTTCACGTTACGAATTCAAATCTTAGCTTAGTTCCCGAGCATTTTTTCAGAAAGGCA
ACTTTAAAAAATTCTGAACGTTATGGAACAGCAGAATTGGCTAAGATTGAAGGTCAGATGTTAGAGGCTAGGGAAGAGTC
ATCTAGTTTAGAATACGATATTTTTATGTGTATTCGAGCTCAAGTTGAAACCTATATTAATCGTTTACAGAAACTGGCTA
AAATTTTGGCAACGGTAGATGTTTTGCAAAGTTTAGCAGTCGTTGCTGAAACCAATCATTATATCCGGCCGCAGTTCAAT
GATAATCATGTGATTACAATTCAAGAAGGTCGTCACGCGGTTGTTGAAAAGGTTATGGGAGTGCAGGAATACATTCCCAA
TAGTATCTCTTTTGACCAACAGACCAGTATTCAGCTGATTACAGGTCCAAATATGAGTGGTAAGTCGACTTATATGAGAC
AGCTGGCCTTAACGGTTATCATGGCCCAGATGGGTTCATTTGTGGCTGCTGATCATGTTGATTTACCTTTATTTGATGCG
ATTTTTACGCGTATTGGGGCTGCTGATGATTTGATTTCTGGGCAATCAACCTTTATGGTGGAGATGATGGAAGCAAACCA
AGCAATCAAACGCGCAAGTGACAACTCTCTTATTCTATTTGATGAACTGGGACGAGGCACGGCAACTTATGATGGTATGG
CTTTAGCCCAGGCAATTATTGAATATATCCATGATAGAGTTGGTGCTAAGACCATATTTGCAACGCATTATCATGAATTG
ACAGACTTGTCAACTAACTTGACAAGTCTAGTCAATGTTCATGTAGCAACGCTTGAAAAAGATGGCGATGTTACCTTCCT
TCATAAGATTGCTGAGGGACCGGCGGATAAATCTTACGGTATTCATGTGGCAAAAATAGCAGGACTGCCAAAATCCCTAT
TAAAGAGAGCAGACGAAGTTCTGACCCGTTTAGAAACACAGTCACGATCTACTGAGATAATATCAGTCCCTTCACAAGTT
GAGTCAAGCAGCGCTGTTAGACAGGGGCAATTATCCCTTTTTGGTGATGAAGAGAAAGCTCATGAGATTAGGCAAGCACT
GGAAGTTATTGATGTCATGAACATGACCCCGCTTCAAGCAATGACAACTCTTTACGAATTGAAAAAGTTGTTATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

71.445

100

0.714

  mutS Pseudomonas stutzeri strain ATCC 17587

37.266

100

0.375