Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   DK41_RS10550 Genome accession   NZ_CP007570
Coordinates   2131358..2133934 (-) Length   858 a.a.
NCBI ID   WP_001118373.1    Uniprot ID   -
Organism   Streptococcus agalactiae strain GBS1-NY     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 2126358..2138934
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  DK41_RS10525 (DK41_10670) - 2126469..2127020 (-) 552 WP_000817342.1 DNA-3-methyladenine glycosylase I -
  DK41_RS10530 (DK41_10675) ruvA 2127043..2127633 (-) 591 WP_000272490.1 Holliday junction branch migration protein RuvA Machinery gene
  DK41_RS10535 (DK41_10680) - 2127635..2128867 (-) 1233 WP_000657480.1 MFS transporter -
  DK41_RS10540 (DK41_10685) hexB 2128899..2130872 (-) 1974 WP_000034616.1 DNA mismatch repair endonuclease MutL Machinery gene
  DK41_RS10545 (DK41_10690) - 2131098..2131301 (+) 204 WP_000191849.1 cold shock domain-containing protein -
  DK41_RS10550 (DK41_10695) hexA 2131358..2133934 (-) 2577 WP_001118373.1 DNA mismatch repair protein MutS Machinery gene
  DK41_RS10555 (DK41_10700) argR 2133991..2134428 (-) 438 WP_001033152.1 arginine repressor -
  DK41_RS10560 (DK41_10705) argS 2134650..2136341 (+) 1692 WP_000379859.1 arginine--tRNA ligase -
  DK41_RS10565 (DK41_10710) - 2136429..2136737 (+) 309 WP_001138859.1 bacteriocin immunity protein -
  DK41_RS10570 (DK41_10715) - 2136764..2137636 (-) 873 WP_000915474.1 YitT family protein -
  DK41_RS10575 (DK41_10720) - 2137744..2138688 (-) 945 WP_000857770.1 YitT family protein -

Sequence


Protein


Download         Length: 858 a.a.        Molecular weight: 97025.69 Da        Isoelectric Point: 4.8723

>NTDB_id=105865 DK41_RS10550 WP_001118373.1 2131358..2133934(-) (hexA) [Streptococcus agalactiae strain GBS1-NY]
MAKPTISPGMQQYLDIKENYPDAFLLFRMGDFYELFYDDAVKAAQILEISLTSRNKNAEKPIPMAGVPYHSAQQYIDVLV
ELGYKVAIAEQMEDPKKAVGVVKREVVQVVTPGTVVESTKPDSANNFLVAIDSQDQQTFGLAYMDVSTGEFQATLLTDFE
SVRSEILNLKAREIVVGYQLTDEKNHLLTKQMNLLLSYEDERLNDIHLIDEQLTDLEISAAEKLLQYVHRTQKRELSHLQ
KVVHYEIKDYLQMSYATKNSLDLLENARTSKKHGSLYWLLDETKTAMGTRMLRTWIDRPLVSMNRIKERQDIIQVFLDYF
FERNDLTESLKGVYDIERLASRVSFGKANPKDLLQLGQTLSQIPRIKMILQSFNQPELDIIVNKIDTMPELESLINTAIA
PEAQATITEGNIIKSGFDKQLDNYRTVMREGTGWIADIEAKERAASGIGTLKIDYNKKDGYYFHVTNSNLSLVPEHFFRK
ATLKNSERYGTAELAKIEGEMLEAREQSSNLEYDIFMRVRAQVESYIKRLQELAKTIATVDVLQSLAVVAENHHYVRPKF
NDEHQIKIKNGRHATVEKVMGVQEYIPNSIYFDSQTDIQLITGPNMSGKSTYMRQLALTVIMAQMGGFVSADEVDLPVFD
AIFTRIGAADDLISGQSTFMVEMMEANQAVKRASDKSLILFDELGRGTATYDGMALAQSIIEYIHDRVRAKTMFATHYHE
LTDLSEQLTRLVNVHVATLERDGEVTFLHKIEPGPADKSYGIHVAKIAGLPIDLLDRATDILSQLEADAVQLIVSAPQEA
VTADLNEELDPGKQQGQLSLFEEHSNAGRVIEELEAIDIMNLTPMQAMNAIFDLKKLL

Nucleotide


Download         Length: 2577 bp        

>NTDB_id=105865 DK41_RS10550 WP_001118373.1 2131358..2133934(-) (hexA) [Streptococcus agalactiae strain GBS1-NY]
ATGGCCAAGCCAACGATATCACCGGGAATGCAACAGTATCTGGATATAAAAGAGAATTATCCAGATGCTTTTTTGCTTTT
TAGAATGGGTGATTTTTATGAATTATTTTATGATGATGCGGTAAAAGCAGCACAAATCCTGGAAATTAGCTTGACTAGTC
GAAATAAGAACGCAGAAAAGCCAATCCCAATGGCAGGAGTTCCCTATCACTCAGCTCAACAGTATATTGACGTTTTAGTT
GAATTAGGTTACAAAGTAGCCATTGCTGAGCAGATGGAAGATCCTAAAAAAGCTGTGGGAGTGGTCAAGCGTGAGGTAGT
GCAAGTTGTTACCCCAGGAACGGTTGTGGAGTCAACGAAGCCGGATAGTGCTAATAATTTCTTAGTAGCGATTGATTCGC
AAGATCAACAAACATTTGGTCTAGCATATATGGATGTCTCAACTGGAGAGTTTCAGGCAACCCTTTTAACAGATTTTGAG
TCCGTCCGTAGTGAAATACTAAATTTAAAAGCTCGTGAGATTGTAGTAGGATATCAATTGACGGACGAAAAAAATCACCT
ACTGACGAAGCAGATGAACTTGCTTTTATCATACGAAGACGAACGACTTAATGATATTCATTTGATTGATGAGCAGTTAA
CTGATTTGGAAATATCTGCTGCGGAAAAACTTTTACAATATGTGCATAGAACACAAAAGCGTGAACTTAGTCATTTACAG
AAAGTCGTTCATTATGAAATAAAGGACTATTTACAAATGTCATATGCAACGAAAAATAGTCTAGATTTACTGGAGAATGC
TAGAACAAGCAAGAAGCATGGAAGTCTTTACTGGTTGTTAGATGAGACTAAAACAGCGATGGGAACTCGAATGCTGAGAA
CTTGGATTGACAGGCCTTTGGTAAGTATGAATCGAATCAAGGAACGTCAAGATATTATTCAAGTGTTTCTTGATTATTTT
TTTGAGAGAAACGATCTCACAGAAAGTTTAAAGGGTGTATATGATATTGAACGCCTAGCAAGTAGAGTATCTTTCGGAAA
AGCCAACCCTAAAGATCTATTGCAACTCGGACAGACCTTATCACAAATTCCTCGAATTAAAATGATTTTACAGTCCTTCA
ATCAACCTGAGCTTGACATCATTGTCAACAAAATTGACACTATGCCTGAATTAGAAAGTTTAATTAATACGGCGATAGCC
CCAGAAGCACAGGCTACTATCACTGAGGGAAACATTATCAAGTCTGGATTTGATAAGCAATTGGATAATTATCGAACAGT
GATGCGTGAAGGTACAGGTTGGATTGCTGATATTGAAGCTAAGGAAAGAGCAGCAAGTGGTATTGGTACCCTTAAAATTG
ATTATAATAAAAAAGACGGCTATTACTTCCATGTGACCAATTCCAATTTATCACTAGTACCGGAGCATTTTTTCCGTAAA
GCGACATTAAAAAATTCTGAACGCTATGGAACAGCAGAACTAGCCAAAATTGAAGGTGAAATGCTCGAAGCTCGCGAGCA
ATCTTCAAATTTAGAATATGATATTTTTATGCGTGTTCGTGCTCAAGTAGAATCTTATATTAAACGTCTTCAAGAGTTAG
CAAAGACTATTGCAACCGTTGATGTTCTACAGAGTTTGGCAGTAGTTGCAGAAAATCATCACTATGTTCGTCCCAAATTT
AATGATGAACATCAGATTAAGATTAAGAATGGGCGTCATGCAACCGTTGAAAAAGTGATGGGAGTGCAAGAATATATTCC
CAATAGTATCTATTTTGATAGTCAGACAGATATCCAGTTGATTACAGGACCAAATATGAGTGGTAAGTCGACCTATATGC
GCCAGTTAGCTTTGACAGTTATTATGGCACAAATGGGAGGTTTTGTATCGGCAGACGAAGTTGATTTGCCTGTATTTGAT
GCAATATTTACTAGGATTGGTGCTGCTGATGACTTAATTTCTGGGCAATCAACCTTTATGGTAGAAATGATGGAAGCGAA
TCAAGCTGTAAAACGAGCCAGTGATAAATCTTTGATTCTTTTTGATGAATTAGGTCGAGGGACAGCCACTTATGATGGTA
TGGCATTAGCTCAATCGATTATAGAATATATTCATGACCGTGTTAGGGCAAAAACAATGTTTGCAACTCATTACCATGAG
TTGACAGATTTATCTGAACAATTGACAAGGCTTGTCAATGTACACGTGGCTACTTTAGAGAGAGATGGAGAAGTTACCTT
CTTACATAAAATTGAACCTGGACCTGCGGACAAGTCTTATGGGATACACGTCGCAAAAATAGCTGGTTTACCAATTGACT
TATTGGATAGGGCAACTGATATTTTATCACAGTTGGAAGCTGATGCAGTACAGTTGATCGTATCAGCCCCCCAAGAAGCT
GTTACTGCTGACTTAAATGAGGAACTAGATCCTGGGAAGCAACAAGGACAATTATCGCTTTTTGAAGAACATTCAAATGC
AGGTAGGGTTATTGAGGAGTTAGAAGCGATAGATATAATGAATCTAACTCCAATGCAAGCTATGAATGCTATATTTGATT
TAAAGAAATTATTATAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

69.338

100

0.696

  mutS Pseudomonas stutzeri strain ATCC 17587

36.758

100

0.375


Multiple sequence alignment