Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   EL107_RS04745 Genome accession   NZ_LR134314
Coordinates   934713..937541 (-) Length   942 a.a.
NCBI ID   WP_023077881.1    Uniprot ID   Q5XA89
Organism   Streptococcus pyogenes strain NCTC8302     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 929713..942541
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  EL107_RS04715 (NCTC8302_00941) - 930389..931354 (+) 966 WP_011184902.1 LacI family DNA-binding transcriptional regulator -
  EL107_RS04720 (NCTC8302_00942) nusB 931495..931947 (-) 453 WP_002983167.1 transcription antitermination factor NusB -
  EL107_RS04725 (NCTC8302_00943) - 931940..932329 (-) 390 WP_002983163.1 Asp23/Gls24 family envelope stress response protein -
  EL107_RS04730 (NCTC8302_00944) efp 932375..932932 (-) 558 WP_002988496.1 elongation factor P -
  EL107_RS04735 (NCTC8302_00945) - 933028..933489 (-) 462 WP_002988493.1 deoxycytidylate deaminase -
  EL107_RS04740 (NCTC8302_00946) - 933524..934597 (-) 1074 WP_021340125.1 M24 family metallopeptidase -
  EL107_RS04745 (NCTC8302_00947) uvrA 934713..937541 (-) 2829 WP_023077881.1 excinuclease ABC subunit UvrA Machinery gene
  EL107_RS04750 (NCTC8302_00948) prx 937768..937950 (-) 183 WP_047149504.1 hypothetical protein Regulator
  EL107_RS04755 (NCTC8302_00950) - 938647..939852 (-) 1206 WP_126409747.1 glucosaminidase domain-containing protein -
  EL107_RS04760 (NCTC8302_00952) - 939975..940202 (-) 228 WP_029714020.1 phage holin -
  EL107_RS04765 (NCTC8302_00953) - 940199..940471 (-) 273 WP_011017397.1 hypothetical protein -
  EL107_RS04770 (NCTC8302_00954) - 940483..941121 (-) 639 WP_046735270.1 hypothetical protein -
  EL107_RS04775 (NCTC8302_00955) - 941124..941552 (-) 429 WP_002988448.1 DUF1617 family protein -

Sequence


Protein


Download         Length: 942 a.a.        Molecular weight: 104062.28 Da        Isoelectric Point: 6.1365

>NTDB_id=1001173 EL107_RS04745 WP_023077881.1 934713..937541(-) (uvrA) [Streptococcus pyogenes strain NCTC8302]
MQNKIIIHGARAHNLKNIDVEIPRDKLVVVTGLSGSGKSSLAFDTIYAEGQRRYVESLSAYARQFLGNMEKPDVDSIDGL
SPAISIDQKTTSKNPRSTVGTVTEINDYLRLLYARVGTPYCINGHGAITASSAEQIVEQVLALPERTRMQILAPIVRRKK
GQHKTIFEKIQKDGYVRVRVDGDIFDVTEVPELSKSKMHNIEVVIDRLVNKDGIRSRLFDSVEAALRLGDGYLMIDTMDG
NELLFSEHYSCPVCGFTVPELEPRLFSFNAPFGSCPTCDGLGIKLEVDLDLVVPDPSKSLKEGALAPWNPISSNYYPTML
EQAMASFGVDMDTPFEALTEEERDLVLYGSGDREFHFHYVNDFGGERNIDIPFEGVVTNVNRRYHETNSDYTRNVMRGYM
NELTCATCHGYRLNDQALCVHVGGEEGPHIGQISELSIADHLQLLEELELTENESTIAKPIVKEIHDRLTFLNNVGLNYL
TLSRAAGTLSGGESQRIRLATQIGSNLSGVLYILDEPSIGLHQRDNDRLIESLKKMRDLGNTLIVVEHDEDTMMQADWLI
DVGPGAGEFGGEIIASGTPKQVAKNKKSITGQYLSGKKFIPVPLERRSGNGRFIEIKGAAQNNLQSLDVRFPLGKFIAVT
GVSGSGKSTLVNSILKKAVAQKLNRNADKPGKYHSISGIEHIERLIDIDQSPIGRTPRSNPATYTGVFDDIRDLFARTNE
AKIRGYKKGRFSFNVKGGRCEACSGDGIIKIEMHFLPDVYVPCEVCHGRRYNSETLEVHYKEKNIAEVLDMTVDDALVFF
SAIPKIARKIQTIKDVGLGYVTLGQPATTLSGGEAQRMKLASELHKRSTGKSLYILDEPTTGLHTDDIARLLKVLERFVD
DGNTVLVIEHNLDVIKSADHIIDLGPEGGVGGGQIVATGTPEEVAQVKESYTGHYLKVKLQQ

Nucleotide


Download         Length: 2829 bp        

>NTDB_id=1001173 EL107_RS04745 WP_023077881.1 934713..937541(-) (uvrA) [Streptococcus pyogenes strain NCTC8302]
ATGCAAAATAAAATAATAATTCATGGGGCAAGAGCCCACAATTTAAAAAATATTGACGTGGAAATTCCACGAGACAAATT
AGTTGTCGTGACAGGGTTATCAGGGTCAGGAAAATCTAGTCTAGCCTTTGATACTATTTATGCGGAAGGGCAACGTCGTT
ACGTAGAAAGTTTATCAGCTTATGCTAGACAGTTCTTGGGTAATATGGAAAAACCAGATGTGGATTCCATTGACGGTCTT
AGCCCTGCTATTTCCATTGATCAAAAAACTACCAGTAAGAACCCCCGCTCAACGGTTGGTACGGTGACTGAAATCAATGA
TTATTTACGTTTACTATATGCGCGTGTGGGCACACCTTACTGTATTAATGGGCATGGGGCCATTACAGCATCTTCTGCAG
AACAAATTGTAGAGCAGGTCTTAGCCCTCCCTGAACGGACACGCATGCAGATTTTAGCGCCTATTGTTCGCCGGAAAAAA
GGTCAACACAAAACCATTTTTGAGAAAATTCAAAAAGATGGTTATGTCCGTGTGCGGGTTGACGGGGATATTTTTGACGT
GACAGAAGTGCCGGAGCTGTCAAAAAGTAAGATGCACAACATCGAGGTGGTTATTGATCGTCTGGTTAATAAGGATGGTA
TTCGTAGCCGTTTATTTGATTCGGTTGAAGCAGCTTTAAGGCTGGGAGATGGCTACCTTATGATTGACACTATGGATGGC
AATGAACTGCTCTTTTCTGAGCATTATTCCTGTCCTGTCTGTGGGTTTACGGTCCCTGAATTAGAACCAAGACTCTTCTC
TTTTAATGCGCCGTTCGGCTCTTGTCCGACCTGTGATGGGCTAGGCATTAAGTTGGAAGTGGATTTGGACTTGGTTGTTC
CTGACCCAAGTAAGTCTTTGAAAGAGGGAGCATTGGCTCCTTGGAATCCTATTTCCTCCAATTACTACCCAACCATGCTT
GAGCAAGCTATGGCGAGTTTTGGGGTGGATATGGATACACCTTTTGAGGCCTTGACTGAGGAAGAAAGAGATTTAGTTCT
TTATGGTTCAGGGGATAGAGAATTTCATTTTCACTATGTGAATGATTTTGGTGGTGAGCGTAACATTGACATTCCTTTTG
AAGGTGTTGTGACTAATGTTAATCGCCGTTATCACGAAACTAATAGTGATTATACGCGCAATGTGATGCGTGGTTATATG
AACGAATTGACCTGTGCGACTTGTCATGGTTACCGTTTGAATGACCAAGCCTTGTGTGTGCATGTGGGTGGCGAAGAAGG
ACCTCATATTGGTCAAATTTCAGAATTATCGATTGCCGACCACTTGCAGTTGTTGGAAGAACTGGAACTCACAGAAAATG
AAAGTACCATTGCTAAACCGATTGTCAAAGAAATTCATGACCGCCTGACCTTCTTAAATAATGTGGGACTGAATTATCTG
ACCTTATCACGTGCTGCTGGGACTTTATCAGGTGGGGAAAGTCAACGAATCAGGTTAGCAACACAAATTGGTTCTAACTT
ATCAGGGGTGCTCTATATCTTGGATGAGCCTTCTATTGGATTGCACCAAAGAGACAATGACCGTTTGATCGAAAGCCTGA
AAAAAATGCGTGATTTGGGTAATACCTTAATTGTGGTAGAACACGATGAAGACACCATGATGCAGGCAGACTGGCTGATT
GATGTGGGTCCTGGGGCAGGTGAGTTCGGTGGAGAAATTATTGCCTCTGGAACGCCGAAACAAGTGGCTAAGAATAAAAA
ATCCATTACGGGTCAATATTTGTCTGGTAAAAAATTCATTCCAGTGCCATTAGAGCGTCGTTCTGGTAATGGCCGATTCA
TTGAAATAAAAGGAGCAGCGCAGAATAATCTTCAAAGCCTCGACGTGAGATTCCCACTGGGTAAATTTATTGCGGTCACA
GGGGTATCAGGCTCAGGGAAATCAACCTTGGTTAATAGTATTTTGAAAAAGGCTGTCGCCCAAAAATTAAACCGTAATGC
TGATAAGCCTGGTAAATATCACTCTATTTCTGGTATTGAACATATTGAACGCTTGATTGACATTGACCAAAGTCCGATTG
GAAGGACGCCACGGTCAAATCCAGCCACCTATACGGGTGTCTTTGATGATATTCGAGACTTGTTTGCCCGAACCAACGAA
GCTAAGATTCGTGGCTACAAAAAAGGCCGTTTCTCTTTTAATGTCAAAGGTGGGCGTTGTGAGGCTTGTTCAGGTGATGG
GATTATCAAAATCGAAATGCACTTTTTGCCAGATGTTTATGTGCCTTGTGAGGTTTGCCACGGCAGACGGTATAATTCTG
AGACGCTTGAGGTGCATTATAAAGAAAAAAATATTGCTGAAGTGCTTGACATGACTGTCGACGATGCCTTGGTATTTTTC
TCTGCTATCCCTAAAATTGCCCGAAAAATTCAAACCATTAAGGATGTTGGTTTGGGTTATGTGACCTTGGGTCAACCAGC
TACTACTCTATCTGGAGGAGAAGCGCAGCGGATGAAATTAGCTAGTGAATTGCACAAACGCTCGACAGGTAAGAGCTTGT
ATATCCTAGATGAGCCAACGACTGGTTTACACACAGATGATATTGCAAGGCTATTAAAAGTTTTGGAACGCTTTGTAGAC
GATGGTAATACGGTTCTTGTGATTGAGCATAATTTGGACGTTATCAAATCTGCTGACCATATTATTGACTTAGGACCAGA
AGGTGGTGTCGGAGGTGGTCAGATTGTTGCCACGGGGACGCCAGAAGAGGTAGCTCAAGTTAAAGAAAGCTATACTGGTC
ATTATTTGAAAGTAAAACTACAACAATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q5XA89

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

84.713

100

0.847

  uvrA Streptococcus pneumoniae TIGR4

84.713

100

0.847

  uvrA Streptococcus pneumoniae D39

84.713

100

0.847