Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   AB5J87_RS26500 Genome accession   NZ_CP163520
Coordinates   5995058..5998057 (+) Length   999 a.a.
NCBI ID   WP_369379917.1    Uniprot ID   -
Organism   Streptomyces sp. cg36     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 5990058..6003057
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  AB5J87_RS26475 (AB5J87_26475) - 5990104..5991384 (-) 1281 WP_369383677.1 MFS transporter -
  AB5J87_RS26480 (AB5J87_26480) - 5991553..5991978 (+) 426 WP_369379911.1 hypothetical protein -
  AB5J87_RS26485 (AB5J87_26485) - 5991984..5993450 (+) 1467 WP_369379912.1 DnaJ C-terminal domain-containing protein -
  AB5J87_RS26490 (AB5J87_26490) - 5993496..5994152 (-) 657 WP_369379914.1 MBL fold metallo-hydrolase -
  AB5J87_RS26495 (AB5J87_26495) - 5994175..5994861 (-) 687 WP_369379915.1 maleylpyruvate isomerase family mycothiol-dependent enzyme -
  AB5J87_RS26500 (AB5J87_26500) uvrA 5995058..5998057 (+) 3000 WP_369379917.1 excinuclease ABC subunit UvrA Machinery gene
  AB5J87_RS26505 (AB5J87_26505) - 5998362..5999255 (-) 894 WP_369383678.1 carbohydrate kinase -
  AB5J87_RS26510 (AB5J87_26510) - 5999395..5999823 (+) 429 WP_369379918.1 Rieske (2Fe-2S) protein -
  AB5J87_RS26515 (AB5J87_26515) - 5999968..6000894 (-) 927 WP_369379920.1 hypothetical protein -
  AB5J87_RS26520 (AB5J87_26520) - 6001209..6001880 (+) 672 WP_369379922.1 papain-like cysteine protease family protein -
  AB5J87_RS26525 (AB5J87_26525) - 6001886..6002692 (+) 807 WP_369383679.1 hypothetical protein -

Sequence


Protein


Download         Length: 999 a.a.        Molecular weight: 109584.85 Da        Isoelectric Point: 7.5497

>NTDB_id=926469 AB5J87_RS26500 WP_369379917.1 5995058..5998057(+) (uvrA) [Streptomyces sp. cg36]
MADRLIVRGAREHNLKNVSLDLPRDSLIVFTGLSGSGKSSLAFDTIFAEGQRRYVESLSSYARQFLGQMDKPDVDFIEGL
SPAVSIDQKSTSRNPRSTVGTITEVYDYLRLLFARIGKPHCPECRRPITRQSPQAIVDKVLELPEGSRFQVLSPLVRERK
GEFVDLFADLQTKGYSRARVDGETIQLSEPPKLKKQEKHTIEVVIDRLTVKDSAKRRLTDSVETALGLSGGMVVLDFVDL
AADDPERERMYSEHLYCPYDDLSFEELEPRSFSFNSPFGACPDCTGIGTRMEVDPELIIPDEDKSLDEGAVSPWSLGHTK
DYFARLVGALADELGFRTDIPWAGLPQRAKKALLYGHKTQIEVRYRNRYGRERAYTTSFEGAVPFVKRRHSEAESDGARE
RFEGYMREVPCPTCEGSRLKPLVLAVTVMDRSIAEVSAMSISDCADFLGELKLNARDKKIAERVLKEVNERLRFLVDVGL
DYLSLNRAAGTLSGGEAQRIRLATQIGSGLVGVLYVLDEPSIGLHQRDNHRLIETLVRLRDMGNTLIVVEHDEDTIKVAD
WVVDIGPGAGEHGGKVVHSGPLKQLLANKESMTGQYLAGKKAIPLPDVRRPADPSRRLTVHGAKENNLRDIDVSFPLGVL
TAVTGVSGSGKSTLVNDILYTHLARELNGARAVPGRHTRVDGDDLVDKVVHVDQSPIGRTPRSNPATYTGVFDNVRKLFA
ETMEAKVRGYLPGRFSFNVKGGRCENCSGDGTIKIEMNFLPDVYVPCEVCHGARYNRETLEVHYKGKSIAEVLDMPIEEA
LDFFEAVPTIARHLRTLNEVGLGYVRLGQSAPTLSGGEAQRVKLASELQKRSTGRTVYVLDEPTTGLHFEDISKLIKVLS
GLVDKGNTVIVIEHNLDVIKTADWVVDMGPEGGSGGGLVIAEGTPEQVASVPASHTGKFLRDILGADRISDAEQAAPVVK
RRGAKKAPAKAVAKTAAKAPAKVSASAPAKKAAARARKA

Nucleotide


Download         Length: 3000 bp        

>NTDB_id=926469 AB5J87_RS26500 WP_369379917.1 5995058..5998057(+) (uvrA) [Streptomyces sp. cg36]
GTGGCCGACCGTCTCATCGTCCGTGGCGCGCGCGAGCACAATCTCAAGAACGTCTCGCTCGACCTCCCGCGCGACTCCCT
CATCGTCTTCACCGGGCTCTCGGGGTCGGGCAAGTCGTCCCTCGCCTTCGACACGATCTTCGCCGAGGGGCAGCGCCGCT
ACGTCGAGTCGCTCTCCTCGTACGCCCGCCAGTTCCTCGGCCAGATGGACAAGCCGGACGTCGACTTCATCGAAGGTCTG
TCGCCCGCGGTCTCCATCGACCAGAAGTCGACCTCGCGCAACCCGCGCTCGACGGTCGGCACCATCACCGAGGTCTACGA
CTACCTGCGCCTGCTCTTCGCGCGCATCGGCAAGCCGCACTGCCCCGAGTGCCGCCGGCCGATCACCCGCCAGTCGCCGC
AGGCCATCGTCGACAAGGTCCTGGAGCTGCCCGAGGGCAGCCGCTTCCAGGTGCTCTCGCCGCTGGTGCGCGAGCGCAAG
GGCGAGTTCGTCGACCTCTTCGCCGACCTCCAGACCAAGGGCTACAGCCGCGCGCGCGTGGACGGCGAGACGATCCAGCT
CTCCGAGCCGCCCAAGCTGAAGAAGCAGGAGAAGCACACCATCGAGGTGGTCATCGACCGCCTCACCGTGAAGGACTCCG
CCAAGCGGCGCCTCACCGACTCGGTGGAGACCGCGCTGGGCCTCTCCGGCGGCATGGTGGTGCTCGACTTCGTCGACCTC
GCGGCCGACGACCCCGAGCGCGAGCGGATGTACTCGGAGCATCTGTACTGCCCGTACGACGACCTGTCCTTCGAGGAGCT
GGAGCCGCGCTCCTTCTCCTTCAACTCGCCCTTCGGCGCCTGCCCCGACTGCACGGGCATCGGCACGCGCATGGAGGTCG
ACCCCGAGCTGATCATTCCGGACGAGGACAAGTCCCTCGACGAGGGCGCGGTCTCCCCGTGGTCGCTCGGCCACACCAAG
GACTACTTCGCCCGGCTGGTCGGCGCGCTCGCCGACGAGCTCGGCTTCCGCACCGACATCCCCTGGGCGGGGCTGCCGCA
GCGTGCCAAGAAGGCGCTGCTGTACGGCCACAAGACCCAGATCGAGGTGCGTTACCGCAACCGGTACGGCAGGGAGCGCG
CCTACACTACCTCCTTCGAGGGCGCGGTGCCGTTCGTCAAGCGGCGCCACTCCGAGGCGGAGTCCGACGGGGCGCGCGAG
CGCTTCGAGGGCTACATGCGCGAGGTCCCCTGCCCGACCTGCGAGGGCTCGCGACTGAAGCCGCTGGTCCTCGCGGTCAC
CGTGATGGACCGCTCCATCGCCGAGGTCTCCGCGATGTCGATCAGCGACTGCGCCGACTTCCTGGGTGAACTCAAGCTCA
ACGCGCGCGACAAGAAGATCGCCGAGCGCGTCCTGAAGGAGGTCAACGAGCGGCTGCGCTTCCTCGTCGACGTCGGCCTC
GACTACCTCTCGCTCAACCGCGCCGCCGGGACGCTGTCCGGCGGCGAGGCCCAGCGCATCCGCCTCGCCACCCAGATCGG
CTCCGGCCTGGTCGGCGTGTTGTACGTGCTGGACGAGCCCTCCATCGGTCTGCACCAGCGCGACAACCACCGGCTGATCG
AGACGCTGGTCCGGCTGCGCGACATGGGCAACACCCTGATCGTCGTCGAGCACGACGAGGACACCATCAAGGTGGCCGAC
TGGGTCGTCGACATCGGCCCCGGCGCCGGTGAGCACGGCGGCAAGGTCGTCCACAGCGGTCCGTTGAAGCAGCTCCTCGC
CAACAAGGAGTCGATGACGGGTCAGTACCTGGCGGGAAAGAAGGCCATCCCGCTGCCGGACGTACGGCGCCCGGCGGACC
CCTCGCGCCGGCTCACGGTGCACGGGGCCAAGGAGAACAACCTCCGCGACATCGACGTCTCGTTCCCGCTCGGGGTGCTC
ACCGCGGTCACCGGAGTCTCCGGCTCCGGCAAGTCGACCCTGGTCAACGACATCCTGTACACCCACCTGGCACGCGAGTT
GAACGGGGCGCGGGCGGTCCCCGGGCGCCACACGCGCGTGGACGGCGACGACCTGGTCGACAAGGTCGTCCATGTCGACC
AGTCGCCGATCGGGCGTACGCCCCGGTCCAATCCGGCCACGTACACCGGCGTCTTCGACAATGTGCGCAAGCTGTTCGCC
GAGACGATGGAGGCGAAGGTGCGGGGCTATCTGCCCGGCCGCTTCTCCTTCAACGTCAAGGGCGGGCGCTGCGAGAACTG
CTCGGGCGACGGCACGATCAAGATCGAGATGAACTTCCTGCCGGACGTGTACGTGCCGTGCGAGGTCTGCCACGGGGCGC
GCTACAACCGGGAGACGCTGGAGGTCCACTACAAGGGCAAGTCCATCGCCGAGGTCCTCGACATGCCGATCGAGGAGGCG
CTCGACTTCTTCGAGGCGGTCCCGACGATCGCCCGCCATCTGCGGACGCTGAACGAGGTGGGCCTCGGTTACGTCCGGCT
CGGCCAGTCCGCGCCGACGCTGTCGGGCGGTGAGGCGCAGCGCGTGAAGCTGGCCTCCGAGCTGCAGAAGCGGTCGACGG
GGCGGACGGTGTACGTGCTCGACGAGCCGACCACCGGTCTCCACTTCGAGGACATCTCGAAGCTGATCAAGGTGCTGTCC
GGGCTGGTCGACAAGGGCAACACGGTGATCGTGATCGAGCACAACCTCGATGTCATCAAGACCGCGGACTGGGTCGTGGA
CATGGGGCCCGAGGGCGGCAGCGGGGGTGGTCTCGTGATCGCGGAGGGCACGCCGGAGCAGGTCGCCTCGGTGCCCGCCA
GTCACACCGGGAAGTTCCTCCGCGACATCCTGGGGGCCGATCGCATCAGTGACGCTGAGCAGGCTGCGCCGGTGGTGAAG
CGGCGGGGGGCGAAGAAAGCTCCCGCGAAGGCGGTGGCCAAGACCGCGGCCAAGGCCCCCGCCAAGGTTTCCGCCTCGGC
TCCGGCCAAGAAGGCGGCTGCCCGGGCGCGCAAGGCCTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

56.508

94.595

0.535

  uvrA Streptococcus pneumoniae TIGR4

56.508

94.595

0.535

  uvrA Streptococcus pneumoniae D39

56.508

94.595

0.535