Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   CR921_RS00320 Genome accession   NZ_CP025399
Coordinates   55629..58187 (+) Length   852 a.a.
NCBI ID   WP_101415505.1    Uniprot ID   -
Organism   Streptococcus thermophilus strain GABA     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 50629..63187
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  CR921_RS00300 purB 50841..52139 (+) 1299 WP_002948159.1 adenylosuccinate lyase -
  CR921_RS00305 argS 53003..54694 (-) 1692 WP_011226739.1 arginine--tRNA ligase -
  CR921_RS00310 argR 54849..55277 (+) 429 WP_024704313.1 arginine repressor -
  CR921_RS00315 - 55277..55636 (+) 360 WP_011225277.1 YlbF family regulator -
  CR921_RS00320 hexA 55629..58187 (+) 2559 WP_101415505.1 DNA mismatch repair protein MutS Machinery gene
  CR921_RS10650 - 58221..58676 (-) 456 Protein_43 DUF3021 domain-containing protein -
  CR921_RS00330 - 58673..59064 (-) 392 Protein_44 LytTR family DNA-binding domain-containing protein -
  CR921_RS00335 - 59288..59593 (+) 306 WP_014621013.1 hypothetical protein -
  CR921_RS00340 hexB 59645..61588 (+) 1944 WP_011680601.1 DNA mismatch repair endonuclease MutL Machinery gene
  CR921_RS00345 - 61718..61939 (+) 222 WP_011680602.1 hypothetical protein -
  CR921_RS00350 ruvA 62091..62681 (+) 591 WP_011680603.1 Holliday junction branch migration protein RuvA Machinery gene

Sequence


Protein


Download         Length: 852 a.a.        Molecular weight: 95527.79 Da        Isoelectric Point: 4.7412

>NTDB_id=218433 CR921_RS00320 WP_101415505.1 55629..58187(+) (hexA) [Streptococcus thermophilus strain GABA]
MAKEKISPGMQQYLDIKKNYPDAFLLFRMGDFYELFYDDAVKAAQILEISLTSRNKNADNPIPMAGVPYHSAQAYIDVLV
EMGYKVAIAEQMEDPKQAVGVVKREVVQVITPGTVVDSSKPDSANNFLVAIDKVGSRFGLSYMDVSTGEFFATELDDFSS
VCSEIQNLKAREVVVGYDLLETDEQVLVNQLNLLLSKETEGYDDVHLIGNSLTDLESSVASKLLQYVHRTQMRELSHLQK
AQHYEIKDYLQMSYATKSSLDLLENARTGKKHGSLFWLLDKTKTAMGMRLLRTWIDRPLVNQASIIERQNIIQVFLDNFF
ERSDLTESLKGVYDIERLASRVSFGKANPKDLIQLGHTLAQVPIIKAILESFNDDTLSGLLQELDALPELESLIRSAIDP
DAPATITEGGIIRDGFDETLDKYRKVMSEGTSWIADIEAKEREASGITTLKIDYNRKDGYYFHVTNSNLSLVPDHFFRKA
TLKNSERFGTAELAKIEGEMLEAREKSSTLEYDIFMRVREQVERYIDRLQSLAKAIATVDVLQSLAVTAETNHYVRPVFN
DEHRIAIDRGRHAVVEKVMGVQEYIPNTITFDSQTNIQLITGPNMSGKSTYMRQLALSVVMAQMGAYVPADSVDLPVFDA
IYTRIGAADDLISGQSTFMVEMMEANQAIKRATPNSLIIFDELGRGTATYDGMALAQSIIEFIHDKVGAKTMFATHYHEL
TALSNSLIHLVNVHVATLEKDGEVTFLHKIVDGPADKSYGIHVAKIAGLPTDLLNRADTILTQLEGETVVIQPQEKVSSQ
EKPAIETHVNEQISLFDDFTENPVLQELRDLDIYNMTPMQVMMTVADLKQKL

Nucleotide


Download         Length: 2559 bp        

>NTDB_id=218433 CR921_RS00320 WP_101415505.1 55629..58187(+) (hexA) [Streptococcus thermophilus strain GABA]
ATGGCTAAGGAAAAAATATCTCCAGGAATGCAGCAGTATTTGGATATCAAGAAAAATTATCCAGATGCTTTTTTGCTGTT
TCGGATGGGGGATTTTTACGAATTATTTTACGATGATGCTGTTAAGGCTGCCCAGATTTTGGAAATTAGCCTAACTAGCC
GTAATAAGAATGCAGATAATCCCATTCCTATGGCAGGTGTGCCTTATCATTCAGCTCAAGCATACATTGATGTTTTGGTT
GAGATGGGCTACAAGGTAGCCATTGCTGAGCAGATGGAGGATCCTAAGCAGGCTGTCGGTGTGGTAAAGCGTGAGGTTGT
TCAGGTTATCACACCAGGTACAGTGGTTGACAGCTCTAAACCTGATAGTGCCAACAATTTCTTGGTGGCCATTGACAAGG
TTGGAAGTCGTTTTGGTCTTTCCTATATGGATGTGTCAACGGGTGAATTTTTTGCGACAGAGTTGGATGATTTTAGTTCA
GTTTGTAGTGAAATTCAGAACCTTAAGGCACGTGAAGTAGTGGTTGGATATGATCTACTTGAAACTGACGAACAAGTTTT
AGTGAACCAACTTAACCTACTTCTCTCCAAGGAAACAGAAGGTTACGATGATGTTCACTTGATTGGTAATAGCTTGACAG
ATTTGGAAAGCAGTGTGGCAAGTAAACTTCTCCAGTATGTTCATCGCACTCAGATGCGTGAGCTCAGTCATTTACAAAAA
GCTCAGCACTATGAGATAAAGGATTACTTGCAGATGTCCTATGCGACCAAGTCAAGCTTGGATTTACTGGAAAATGCTAG
AACGGGCAAGAAACACGGTTCTCTTTTCTGGCTCTTGGATAAAACCAAGACAGCCATGGGAATGCGTCTCTTGCGAACTT
GGATTGATCGTCCTTTAGTGAATCAAGCCAGCATCATAGAGCGTCAGAATATTATCCAAGTTTTCTTGGACAATTTCTTT
GAGCGTAGTGACTTGACCGAGAGTCTAAAAGGTGTTTACGATATTGAGCGTCTGGCCAGTCGTGTTTCCTTTGGCAAGGC
TAATCCTAAAGATTTAATTCAGCTAGGTCATACCTTAGCTCAGGTTCCGATCATTAAGGCAATCTTGGAGTCCTTTAATG
ACGATACCTTGTCAGGTCTTTTACAAGAGTTAGATGCTTTGCCAGAATTAGAGAGTTTGATTCGTTCGGCTATTGATCCT
GATGCTCCAGCAACAATTACAGAAGGTGGTATTATTCGTGATGGTTTTGATGAGACCTTGGACAAGTATCGCAAAGTGAT
GAGCGAGGGGACGTCATGGATTGCGGATATCGAAGCAAAAGAACGCGAAGCGTCTGGTATTACAACACTAAAAATTGATT
ATAACCGTAAAGATGGTTATTACTTCCATGTGACCAACTCTAACCTTAGTTTGGTTCCTGACCATTTCTTCCGTAAGGCG
ACACTGAAAAATTCGGAGCGTTTTGGAACTGCTGAGTTGGCTAAGATTGAAGGTGAAATGCTAGAAGCACGTGAAAAATC
GTCAACCCTAGAGTATGATATTTTCATGCGTGTCCGTGAGCAGGTTGAACGCTATATCGACCGTTTGCAGTCTTTGGCTA
AGGCCATTGCAACAGTCGATGTGCTTCAGAGTTTGGCTGTTACAGCGGAGACAAATCATTATGTTCGTCCTGTTTTTAAT
GATGAGCATCGTATCGCTATTGATCGGGGCCGTCATGCGGTGGTTGAGAAGGTTATGGGCGTTCAGGAATACATTCCAAA
TACGATTACCTTTGACAGTCAGACCAATATTCAGCTCATCACAGGACCAAATATGAGTGGTAAATCTACCTATATGCGGC
AGTTAGCCTTGTCAGTAGTTATGGCTCAAATGGGGGCTTACGTACCAGCAGATAGTGTTGATTTACCTGTTTTTGACGCC
ATCTATACACGTATAGGTGCCGCAGATGACCTGATTTCAGGTCAGTCGACCTTCATGGTTGAGATGATGGAGGCTAATCA
GGCCATTAAGCGAGCGACACCTAATTCCTTGATTATTTTTGATGAGTTGGGGCGTGGGACAGCCACTTATGATGGTATGG
CTTTGGCCCAGTCTATTATTGAGTTTATTCATGACAAGGTTGGGGCTAAGACCATGTTTGCTACCCATTATCATGAGTTG
ACTGCGCTGTCAAACAGTTTGATACACCTTGTCAACGTCCATGTTGCGACACTTGAAAAGGATGGCGAAGTGACTTTCCT
CCACAAAATTGTCGATGGTCCAGCCGATAAATCGTATGGTATTCATGTAGCTAAAATTGCAGGTTTACCAACAGATTTAT
TGAACCGTGCTGACACCATATTGACACAATTAGAAGGAGAGACAGTTGTAATCCAACCTCAGGAAAAGGTATCGTCTCAA
GAAAAGCCTGCCATTGAAACGCATGTCAACGAGCAAATCTCTCTCTTTGATGACTTTACTGAAAATCCGGTTCTTCAAGA
GTTGCGTGATTTGGACATTTACAACATGACACCGATGCAAGTCATGATGACTGTAGCAGATTTAAAACAGAAACTATAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

74.061

100

0.741

  mutS Pseudomonas stutzeri strain ATCC 17587

35.788

100

0.365


Multiple sequence alignment