Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   C1A39_RS00315 Genome accession   NZ_CP028896
Coordinates   54222..56780 (+) Length   852 a.a.
NCBI ID   WP_014607836.1    Uniprot ID   -
Organism   Streptococcus thermophilus strain CS5     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 49222..61780
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  C1A39_RS00295 (C1A39_00295) purB 49434..50732 (+) 1299 WP_002948159.1 adenylosuccinate lyase -
  C1A39_RS00300 (C1A39_00300) argS 51596..53287 (-) 1692 WP_024704312.1 arginine--tRNA ligase -
  C1A39_RS00305 (C1A39_00305) argR 53442..53870 (+) 429 WP_024704313.1 arginine repressor -
  C1A39_RS00310 (C1A39_00310) - 53870..54229 (+) 360 WP_011225277.1 YlbF family regulator -
  C1A39_RS00315 (C1A39_00315) hexA 54222..56780 (+) 2559 WP_014607836.1 DNA mismatch repair protein MutS Machinery gene
  C1A39_RS10225 (C1A39_00320) - 56814..57269 (-) 456 Protein_44 DUF3021 domain-containing protein -
  C1A39_RS00325 (C1A39_00325) - 57266..57657 (-) 392 Protein_45 LytTR family DNA-binding domain-containing protein -
  C1A39_RS00330 (C1A39_00330) - 57881..58186 (+) 306 WP_002949050.1 hypothetical protein -
  C1A39_RS00335 (C1A39_00335) hexB 58238..60181 (+) 1944 WP_014607839.1 DNA mismatch repair endonuclease MutL Machinery gene
  C1A39_RS00340 (C1A39_00340) - 60311..60532 (+) 222 WP_011680602.1 hypothetical protein -
  C1A39_RS00345 (C1A39_00345) ruvA 60684..61274 (+) 591 WP_011680603.1 Holliday junction branch migration protein RuvA Machinery gene

Sequence


Protein


Download         Length: 852 a.a.        Molecular weight: 95483.73 Da        Isoelectric Point: 4.7412

>NTDB_id=248993 C1A39_RS00315 WP_014607836.1 54222..56780(+) (hexA) [Streptococcus thermophilus strain CS5]
MAKEKISPGMQQYLDIKKNYPDAFLLFRMGDFYELFYDDAVKAAQILEISLTSRNKNADNPIPMAGVPYHSAQAYIDVLV
EMGYKVAIAEQMEDPKQAVGVVKREVVQVITPGTVVDSSKPDSANNFLVAIDKVGSRFGLSYMDVSTGEFFATELDDFSS
VCSEIQNLKAREVVVGYDLLETDEQVLVNQLNLLLSKETEGYDDVHLIGNSLTDLESSVASKLLQYVHRTQMRELSHLQK
AQHYEIKDYLQMSYATKSSLDLLENARTGKKHGSLFWLLDKTKTAMGMRLLRTWIDRPLVNQASIIERQNIIQVFLDNFF
ERSDLTESLKGVYDIERLASRVSFGKANPKDLIQLGHTLAQVPVIKAILESFNDDTLSGLLQELDALPELESLIRSAIDP
DAPATITEGGIIRDGFDETLDKYRKVMSEGTSWIADIEAKEREASGITTLKIDYNRKDGYYFHVTNSNLSLVPDHFFRKA
TLKNSERFGTAELAKIEGEMLEAREKSSTLEYDIFMRVREQVERYIDRLQSLAKAIATVDVLQSLAVTAETNHYVRPVFN
DEHRIAIDRGRHAVVEKVMGVQEYIPNTITFDSQTNIQLITGPNMSGKSTYMRQLALSVVMAQMGAYVPADSVDLPVFDA
IYTRIGAADDLISGQSTFMVEMMEANQAIKRATPNSLIIFDELGRGTATYDGMALAQSIIEFIHDKVGAKTMFATHYHEL
TALSNSLIHLVNVHVATLEKDGEVTFLHKIVDGPADKSYGIHVAKIAGLPTDLLNRADTILTQLEGETVVIQPQEKVSSQ
EKPAIETHVNEQISLFDDFTENPVLQELRDLDIYNMTPMQVMMAVADLKQKL

Nucleotide


Download         Length: 2559 bp        

>NTDB_id=248993 C1A39_RS00315 WP_014607836.1 54222..56780(+) (hexA) [Streptococcus thermophilus strain CS5]
ATGGCTAAGGAAAAGATATCTCCAGGAATGCAGCAGTATTTGGATATCAAGAAAAATTATCCAGATGCTTTTTTGCTGTT
TCGGATGGGGGATTTTTACGAATTATTTTACGATGATGCTGTTAAGGCTGCCCAGATTTTGGAAATTAGCCTAACTAGCC
GTAATAAGAATGCAGATAATCCCATTCCTATGGCAGGTGTGCCTTATCATTCAGCTCAAGCATACATTGATGTTTTGGTT
GAGATGGGCTACAAGGTAGCCATTGCTGAGCAGATGGAGGATCCTAAGCAGGCTGTCGGTGTGGTAAAGCGTGAGGTTGT
TCAGGTTATCACACCAGGTACAGTGGTTGACAGCTCTAAACCTGATAGTGCCAACAATTTCTTGGTGGCCATTGACAAGG
TTGGAAGTCGTTTTGGTCTTTCCTATATGGATGTGTCAACGGGTGAATTTTTTGCGACAGAGTTGGATGATTTTAGTTCA
GTTTGTAGTGAAATTCAGAACCTTAAGGCACGTGAAGTAGTGGTTGGATATGATCTACTTGAAACTGACGAACAAGTTTT
AGTGAACCAACTTAACCTACTTCTCTCCAAGGAAACAGAAGGTTACGATGATGTTCACTTGATTGGTAATAGCTTGACAG
ATTTGGAAAGCAGTGTGGCAAGTAAACTTCTCCAGTATGTTCATCGCACTCAGATGCGTGAGCTCAGTCATTTACAAAAA
GCTCAGCACTATGAGATAAAGGATTACTTGCAGATGTCCTATGCGACCAAGTCAAGCTTGGATTTACTGGAAAATGCTAG
AACGGGCAAGAAACACGGTTCTCTTTTCTGGCTCTTGGATAAAACCAAGACAGCCATGGGAATGCGTCTCTTGCGAACTT
GGATTGATCGTCCTTTAGTGAATCAAGCCAGCATCATAGAGCGTCAGAATATTATCCAAGTTTTCTTGGACAATTTCTTT
GAGCGTAGTGACTTGACCGAGAGTCTAAAAGGTGTTTACGATATTGAGCGTCTGGCCAGTCGTGTTTCCTTTGGCAAGGC
TAATCCTAAAGATTTAATTCAGCTAGGTCATACCTTAGCTCAGGTTCCGGTCATTAAGGCAATCTTGGAGTCCTTTAATG
ACGATACCTTGTCAGGTCTTTTACAAGAGTTAGATGCTTTGCCAGAATTAGAGAGTTTGATTCGTTCGGCTATTGATCCT
GATGCTCCAGCAACAATTACAGAAGGTGGTATTATTCGTGATGGTTTTGATGAGACCTTGGACAAGTATCGCAAAGTGAT
GAGCGAGGGGACGTCATGGATTGCGGATATCGAAGCAAAAGAACGCGAAGCGTCTGGTATTACAACACTAAAAATTGATT
ATAACCGTAAAGATGGTTATTACTTCCATGTGACCAACTCTAACCTTAGTTTGGTTCCTGACCATTTCTTCCGTAAGGCG
ACACTGAAAAATTCGGAGCGTTTTGGAACTGCTGAGTTGGCTAAGATTGAAGGTGAAATGCTAGAAGCACGTGAAAAATC
GTCAACCCTAGAGTATGATATTTTCATGCGTGTCCGTGAGCAGGTTGAACGCTATATCGACCGTTTGCAGTCTTTGGCTA
AGGCCATTGCAACAGTCGATGTGCTTCAGAGTTTGGCTGTTACAGCGGAGACAAATCATTATGTTCGTCCTGTTTTTAAT
GATGAGCATCGTATCGCTATTGATCGGGGCCGTCATGCAGTGGTTGAGAAGGTTATGGGCGTTCAGGAATACATTCCAAA
TACGATTACCTTTGACAGTCAGACCAATATTCAGCTCATCACAGGACCAAATATGAGTGGTAAATCTACCTATATGCGGC
AGTTAGCCTTGTCAGTAGTTATGGCTCAAATGGGGGCTTACGTACCAGCAGATAGTGTTGATTTACCTGTTTTTGACGCC
ATCTATACACGTATAGGTGCCGCAGATGACCTGATTTCAGGTCAGTCGACCTTCATGGTTGAGATGATGGAGGCTAATCA
GGCCATTAAGCGAGCGACACCTAATTCCTTGATTATTTTTGATGAGTTGGGGCGTGGGACAGCCACTTATGATGGTATGG
CTTTGGCCCAGTCTATTATTGAGTTTATTCATGACAAGGTTGGGGCTAAGACCATGTTTGCTACCCATTATCATGAGTTG
ACTGCGCTGTCAAACAGTTTGATACACCTTGTCAACGTCCATGTTGCGACACTTGAAAAGGATGGCGAAGTGACTTTCCT
CCACAAAATTGTCGATGGTCCAGCCGATAAATCGTATGGTATTCATGTAGCTAAAATTGCAGGTTTACCAACAGATTTAT
TGAACCGTGCTGACACCATATTGACACAATTAGAAGGAGAGACAGTTGTAATCCAACCTCAGGAAAAGGTATCGTCTCAA
GAAAAGCCTGCCATTGAAACGCATGTCAACGAGCAAATCTCTCTCTTTGATGACTTTACTGAAAATCCGGTTCTTCAAGA
GTTGCGTGATTTGGACATTTACAACATGACACCGATGCAAGTCATGATGGCTGTAGCAGATTTAAAACAGAAACTATAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

74.061

100

0.741

  mutS Pseudomonas stutzeri strain ATCC 17587

35.788

100

0.365