Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexB   Type   Machinery gene
Locus tag   STCNRZ1151_RS00340 Genome accession   NZ_CP065483
Coordinates   58251..60194 (+) Length   647 a.a.
NCBI ID   WP_011225282.1    Uniprot ID   Q5M6H7
Organism   Streptococcus thermophilus strain CNRZ1151     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 53251..65194
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  STCNRZ1151_RS00305 (STCNRZ1151_00305) argR 53455..53883 (+) 429 WP_024704313.1 arginine repressor -
  STCNRZ1151_RS00310 (STCNRZ1151_00310) - 53883..54242 (+) 360 WP_011225277.1 YlbF family regulator -
  STCNRZ1151_RS00315 (STCNRZ1151_00315) hexA 54235..56793 (+) 2559 WP_179971847.1 DNA mismatch repair protein MutS Machinery gene
  STCNRZ1151_RS09455 (STCNRZ1151_00320) - 56827..57282 (-) 456 Protein_42 DUF3021 domain-containing protein -
  STCNRZ1151_RS00330 (STCNRZ1151_00325) - 57279..57670 (-) 392 Protein_43 LytTR family DNA-binding domain-containing protein -
  STCNRZ1151_RS00335 (STCNRZ1151_00330) - 57894..58199 (+) 306 WP_002949050.1 hypothetical protein -
  STCNRZ1151_RS00340 (STCNRZ1151_00335) hexB 58251..60194 (+) 1944 WP_011225282.1 DNA mismatch repair endonuclease MutL Machinery gene
  STCNRZ1151_RS00345 (STCNRZ1151_00340) - 60324..60545 (+) 222 WP_041826940.1 hypothetical protein -
  STCNRZ1151_RS00350 (STCNRZ1151_00345) ruvA 60697..61287 (+) 591 WP_002949053.1 Holliday junction branch migration protein RuvA Machinery gene
  STCNRZ1151_RS00355 (STCNRZ1151_00350) - 61294..61849 (+) 556 Protein_48 DNA-3-methyladenine glycosylase I -
  STCNRZ1151_RS00360 (STCNRZ1151_00355) cinA 61945..63216 (+) 1272 WP_011226745.1 competence/damage-inducible protein A Machinery gene
  STCNRZ1151_RS00365 (STCNRZ1151_00360) recA 63252..64406 (+) 1155 WP_011226746.1 recombinase RecA Machinery gene
  STCNRZ1151_RS00370 (STCNRZ1151_00365) spx 64583..64981 (+) 399 WP_002949058.1 transcriptional regulator Spx -

Sequence


Protein


Download         Length: 647 a.a.        Molecular weight: 72504.77 Da        Isoelectric Point: 5.9934

>NTDB_id=447970 STCNRZ1151_RS00340 WP_011225282.1 58251..60194(+) (hexB) [Streptococcus thermophilus strain CNRZ1151]
MPKIIELPEVLANQIAAGEVVERPASVVKELVENAIDAGSTQITIEVEESGLSKIQITDNGEGMAQADVAMSLRRHATSK
IKNQGDLFRIRTLGFRGEALPSIASISHLTIVTAADGEVYGTKLVAKGGEIESQDPISTPVGTKITVENLFYNTPARLKY
MKSLQAELAHIVDVVNRLSLAHPEVAFTLLNDGRQLTQTSGTGDLRQAIAGIYGLTTAKKMVEISNSDLDFEVSGYVSLP
ELTRANRNYITILINGRYIKNFLLNRAIFDGYGSKLMVGRFPIAVIDIQIDPYLADVNVHPTKQEVRISKEKELMALIKS
AIAQSLREQDLIPDALENLAKSSTRGATRSVQTSLPLKQTNLYYDSSRNDFFVTPETVQEDIKPLVSKSESSVSLVANKQ
QPTVKQAKRSADDSDSEHGKLDYKNKSKLKRMLENLTNEETSTFPELEFFGQMHGTYLFAQGQGGLYIIDQHAAQERVKY
EYYREKIGVVDSSLQQLLVPYLFEFSGSDYISLQEKMPLLNQVCIYLEPYGNNTFILREHPIWMKEEEIESAVYEMCDML
LLTNEVSVKTYRAELAIMMSCKRSIKANHALDDYSARDLLVQLAQCKNPYNCPHGRPVLVNFTKSDMEKMFRRIQENHTS
LRDLGKY

Nucleotide


Download         Length: 1944 bp        

>NTDB_id=447970 STCNRZ1151_RS00340 WP_011225282.1 58251..60194(+) (hexB) [Streptococcus thermophilus strain CNRZ1151]
ATGCCAAAAATTATCGAATTGCCTGAAGTTCTAGCCAATCAGATTGCTGCTGGTGAGGTCGTAGAGCGACCAGCTAGTGT
AGTTAAAGAGCTGGTGGAAAATGCTATTGATGCAGGCAGCACCCAGATTACTATTGAAGTTGAAGAATCAGGCCTCTCAA
AAATTCAAATCACAGACAATGGCGAAGGAATGGCTCAAGCTGATGTAGCTATGAGTTTGCGCCGTCATGCAACGAGTAAA
ATCAAAAATCAAGGAGATCTCTTTCGTATTCGAACACTTGGTTTTCGAGGTGAAGCCCTACCCTCTATAGCTTCTATTAG
TCACCTTACCATTGTGACAGCAGCGGATGGAGAAGTCTATGGGACCAAACTTGTTGCTAAAGGTGGAGAAATTGAGAGTC
AAGATCCTATTTCAACCCCAGTGGGAACAAAGATTACAGTTGAAAACTTGTTTTATAACACCCCAGCTCGTCTCAAGTAT
ATGAAGAGTTTACAGGCTGAGTTGGCTCATATTGTCGATGTTGTCAACCGTTTGAGTTTAGCCCACCCCGAAGTAGCCTT
CACCTTGCTTAATGATGGTCGTCAGTTGACACAGACATCAGGTACTGGAGACCTTCGCCAAGCTATTGCAGGGATTTATG
GCTTAACAACAGCAAAAAAAATGGTGGAAATTTCAAATTCCGACCTTGATTTTGAAGTTTCTGGTTATGTCAGTCTCCCT
GAATTAACGCGTGCTAACCGTAACTACATCACGATTCTCATTAACGGACGCTATATAAAAAACTTCCTCCTTAACCGTGC
TATTTTTGATGGTTATGGTTCTAAACTTATGGTGGGACGCTTCCCAATTGCAGTTATTGATATTCAGATTGATCCTTATT
TGGCAGATGTCAATGTTCACCCAACAAAGCAAGAAGTACGTATCTCTAAAGAAAAGGAGCTCATGGCCCTTATCAAATCT
GCCATTGCTCAAAGCCTTAGAGAGCAGGATTTGATTCCTGATGCCCTTGAAAATCTAGCAAAGTCAAGTACTAGAGGTGC
AACTAGGTCAGTTCAGACGAGTCTCCCACTCAAACAAACCAATCTTTACTATGACAGTAGCCGTAATGATTTCTTTGTCA
CGCCAGAGACAGTTCAAGAGGATATCAAACCTCTTGTATCAAAGTCAGAGTCTTCAGTTTCATTGGTAGCAAACAAACAG
CAACCTACTGTTAAACAGGCAAAACGTTCAGCAGATGATAGTGATAGCGAACACGGAAAACTTGACTATAAAAATAAATC
GAAATTGAAGCGCATGCTTGAAAATCTGACCAATGAGGAAACATCAACCTTTCCTGAATTGGAGTTCTTTGGTCAAATGC
ATGGAACCTACCTCTTTGCCCAAGGACAAGGTGGCCTTTACATCATTGACCAGCATGCTGCCCAAGAACGTGTCAAGTAT
GAGTACTATCGCGAAAAGATAGGTGTGGTTGATAGTAGTTTACAACAACTTTTGGTTCCCTATCTTTTTGAATTTTCAGG
TTCAGATTACATTAGTTTACAAGAAAAAATGCCTCTTCTTAACCAAGTTTGCATCTATTTGGAGCCTTATGGGAATAATA
CCTTCATTCTTCGAGAGCACCCTATCTGGATGAAGGAAGAAGAAATCGAATCTGCAGTCTATGAGATGTGTGATATGCTT
CTTTTGACGAACGAAGTATCCGTCAAGACCTATCGTGCTGAGTTAGCCATCATGATGAGTTGTAAACGTTCAATAAAGGC
CAATCATGCTCTTGATGATTACTCTGCGCGTGACCTTCTAGTACAGCTTGCACAGTGTAAAAATCCCTATAATTGTCCTC
ACGGCCGTCCAGTACTTGTCAACTTTACCAAGTCTGATATGGAAAAAATGTTCCGTCGTATTCAAGAAAACCATACCAGC
CTACGTGATTTAGGAAAGTATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q5M6H7

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexB Streptococcus pneumoniae R6

69.419

100

0.702