Detailed information    

insolico Bioinformatically predicted

Overview


Name   hexA   Type   Machinery gene
Locus tag   AB849_RS10675 Genome accession   NZ_CP036487
Coordinates   2096769..2099309 (+) Length   846 a.a.
NCBI ID   WP_236533590.1    Uniprot ID   -
Organism   Thermoactinomyces vulgaris strain CDF     
Function   DNA mismatch repair (predicted from homology)   
Homologous recombination

Genomic Context


Location: 2091769..2104309
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  AB849_RS10655 (AB849_010655) cotE 2092289..2092885 (+) 597 WP_037996865.1 outer spore coat protein CotE -
  AB849_RS10660 (AB849_010660) - 2093041..2094432 (+) 1392 WP_049720189.1 putative amidoligase domain-containing protein -
  AB849_RS13735 (AB849_010665) - 2094507..2094608 (+) 102 Protein_2078 hypothetical protein -
  AB849_RS10670 (AB849_010670) - 2095177..2096679 (+) 1503 WP_049720188.1 reverse transcriptase/maturase family protein -
  AB849_RS10675 (AB849_010675) hexA 2096769..2099309 (+) 2541 WP_236533590.1 DNA mismatch repair protein MutS Machinery gene
  AB849_RS10680 (AB849_010680) hexB 2099338..2101308 (+) 1971 WP_049720186.1 DNA mismatch repair endonuclease MutL Machinery gene
  AB849_RS10685 (AB849_010685) - 2101311..2102093 (+) 783 WP_131470926.1 class I SAM-dependent methyltransferase -
  AB849_RS10690 (AB849_010690) miaA 2102090..2103019 (+) 930 WP_037996858.1 tRNA (adenosine(37)-N6)-dimethylallyltransferase MiaA -
  AB849_RS10695 (AB849_010695) hfq 2103062..2103304 (+) 243 WP_037996856.1 RNA chaperone Hfq -

Sequence


Protein


Download         Length: 846 a.a.        Molecular weight: 95307.98 Da        Isoelectric Point: 5.6032

>NTDB_id=307928 AB849_RS10675 WP_236533590.1 2096769..2099309(+) (hexA) [Thermoactinomyces vulgaris strain CDF]
MFLLYFEDAEKAAEELEITLTSRDGGSERIPMCGVPYHSAHTYVEKLIDQGYKVAICEQVEDPSAAKGVVKREVVRVITP
GTIMEENMLVDQENNFLVTLTGSENQMALAAVDLSTGECHITEMSGSLDAILDEISSYRPKEIVLDESLADQAAVKEQIQ
SRLKCLITPHGMDAGSEKKLSEELPAQFPQYPELCDTPFLRKVVALLFSYLKQTQKRALHHLQRLHRYDARQYMMLDEAA
RRNLELTATLGEGKKKGSLLWLLDQTATAMGSRLLKKWLDKPLLSLEEITRRQNMVEALLSDFLLLDEVRDRMKQVYDLE
RLAARISYGSANARDLNSVKRSLSIIPELKEKLLQSDSRPLKELAEKMDELADVKSLIDEALVEEAPVSVKEGGIIREGF
HEELDQLRKIQKDGKSWIAELEQKERDTTGIKSLKIRYNRVFGYYIEVTKSNLHLVPKDRYHRKQTLANSERYITPELKE
REQLILNASEKSVELEYELFTKVRDQVADQVQRLQSLAERVAELDVLHAFALIAQKYQYVRPKVHTGSQLKIKAGRHPVV
EAVTNTGEFVANDAELDQEDRQVLLVTGPNMAGKSTYMRQVALIVILSQIGSFVPAEEAEISIVDRVFTRIGAADDLTGG
RSTFMVEMSETCHALKEATRRSLILLDEVGRGTSTYDGMALAHAIVEYIHDHVGAKTLFSTHYHELTKLEESLSRLKNVH
AQCIERNGKVVFLHRIVPGGADRSYGIQVAELAGLPKEVITRAKQLLTELEKGTPAPSNTGASPDSSGQLSLFDPLEIQP
ATRETAASSLTSEEQEVLEAVRKWDLMNKTPFECMQFLHEIKQKLN

Nucleotide


Download         Length: 2541 bp        

>NTDB_id=307928 AB849_RS10675 WP_236533590.1 2096769..2099309(+) (hexA) [Thermoactinomyces vulgaris strain CDF]
TTGTTCCTACTCTACTTCGAAGATGCCGAAAAAGCAGCCGAAGAGCTGGAGATTACATTGACCAGCCGGGATGGTGGCAG
TGAACGCATTCCCATGTGCGGGGTTCCTTATCATTCGGCTCACACTTATGTGGAAAAATTGATTGATCAGGGATATAAAG
TGGCCATCTGTGAGCAGGTGGAAGATCCTTCCGCTGCCAAAGGGGTGGTCAAGCGGGAAGTGGTTCGCGTGATCACGCCC
GGGACCATCATGGAAGAAAATATGCTGGTCGACCAGGAAAATAATTTTTTGGTGACGCTGACCGGAAGCGAAAACCAAAT
GGCATTGGCGGCAGTGGATTTGTCCACGGGAGAGTGCCACATTACGGAGATGAGCGGTTCGCTGGACGCGATTTTGGATG
AAATTTCTTCGTATCGGCCGAAAGAAATCGTGTTGGATGAATCCTTGGCAGATCAAGCGGCGGTAAAAGAACAGATTCAA
TCCCGCTTAAAATGTTTGATCACGCCGCATGGCATGGATGCCGGTTCCGAAAAGAAACTGTCCGAAGAGTTGCCGGCGCA
GTTTCCGCAATACCCCGAGCTGTGCGATACCCCGTTTTTGCGAAAAGTGGTCGCCTTGTTATTCTCTTATCTGAAACAAA
CGCAAAAGCGGGCTCTGCATCATTTGCAGCGGTTGCACCGGTATGACGCCAGGCAGTATATGATGTTGGATGAAGCGGCG
AGAAGAAACCTGGAATTGACGGCAACGCTTGGCGAAGGAAAGAAAAAAGGTTCGCTATTGTGGCTGTTGGATCAAACGGC
CACCGCAATGGGGAGCCGGTTGTTGAAAAAATGGCTGGACAAGCCGCTTCTGTCACTGGAAGAGATCACCCGGCGCCAAA
ATATGGTGGAAGCGTTGCTTTCCGACTTTTTGTTGCTGGATGAAGTGCGGGACCGGATGAAACAAGTTTATGATTTGGAG
CGGCTGGCGGCGCGCATTTCTTACGGATCGGCCAATGCGCGGGATTTAAACAGTGTGAAAAGATCGCTTTCCATCATTCC
CGAACTGAAAGAGAAATTGTTGCAATCCGACTCCCGGCCGCTGAAGGAATTGGCGGAAAAAATGGATGAGTTGGCGGATG
TAAAAAGCCTCATCGACGAAGCGTTGGTGGAAGAAGCGCCGGTTTCCGTCAAGGAAGGCGGCATCATCCGCGAAGGCTTC
CATGAAGAATTGGACCAATTGCGGAAGATCCAGAAAGACGGGAAAAGCTGGATTGCCGAGCTGGAGCAGAAAGAAAGAGA
CACGACGGGAATCAAGTCGCTAAAAATCCGTTATAACCGCGTGTTCGGCTATTATATCGAGGTTACCAAGTCCAATCTGC
ATCTGGTTCCCAAAGATCGGTACCACCGCAAGCAAACGCTTGCCAATTCGGAACGGTATATCACGCCGGAATTAAAAGAA
CGGGAACAGCTCATCTTAAATGCTTCGGAAAAATCAGTGGAACTGGAATATGAACTGTTTACAAAGGTCCGGGATCAGGT
GGCGGACCAGGTTCAACGATTGCAATCTCTGGCCGAACGGGTGGCCGAGTTGGATGTATTGCACGCCTTTGCGCTGATTG
CCCAAAAGTATCAATATGTCCGTCCGAAAGTGCATACAGGCAGTCAGCTGAAAATCAAAGCAGGCCGCCATCCGGTCGTC
GAAGCCGTTACCAATACGGGGGAATTTGTGGCCAATGATGCGGAGTTGGATCAGGAAGACCGCCAAGTCTTATTGGTGAC
GGGGCCGAACATGGCCGGAAAAAGCACGTACATGAGACAAGTGGCTTTGATTGTGATTTTAAGCCAGATCGGAAGTTTCG
TTCCGGCGGAAGAAGCGGAAATTTCCATTGTGGACCGCGTGTTTACCCGGATCGGGGCGGCGGATGATTTGACCGGCGGG
CGGAGCACGTTTATGGTGGAGATGTCTGAAACCTGCCATGCCCTGAAGGAGGCCACCCGGAGGAGCTTGATCCTGCTGGA
CGAAGTGGGACGAGGAACATCCACTTATGACGGGATGGCTCTCGCGCATGCCATCGTGGAATACATTCATGACCATGTGG
GAGCCAAGACGCTGTTTTCCACCCATTATCATGAGTTGACAAAACTGGAGGAATCATTGTCCCGGTTGAAGAATGTGCAT
GCCCAATGCATTGAGCGGAACGGAAAGGTGGTCTTTTTGCACCGGATTGTCCCGGGAGGGGCGGATCGCAGTTACGGGAT
TCAGGTGGCCGAGCTGGCCGGGCTGCCGAAAGAAGTGATCACAAGAGCCAAACAGTTGTTGACCGAATTGGAAAAAGGCA
CACCCGCACCTTCAAACACCGGTGCTTCCCCGGATTCGTCGGGGCAGTTGTCCTTGTTCGATCCGTTGGAAATTCAACCG
GCAACCAGGGAGACGGCCGCTTCGTCTTTGACCTCCGAAGAACAAGAAGTTTTGGAGGCCGTCCGCAAGTGGGATTTAAT
GAATAAGACCCCGTTTGAATGCATGCAGTTTTTGCATGAGATCAAACAAAAATTAAATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  hexA Streptococcus pneumoniae R6

46.054

100

0.462

  mutS Pseudomonas stutzeri strain ATCC 17587

38.824

100

0.39


Multiple sequence alignment