Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   DQL02_RS06945 Genome accession   NZ_LS483355
Coordinates   1377951..1380779 (-) Length   942 a.a.
NCBI ID   WP_011054967.1    Uniprot ID   P0CZ41
Organism   Streptococcus pyogenes strain NCTC12067     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1372951..1385779
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  DQL02_RS06915 (NCTC12067_01376) - 1373628..1374593 (+) 966 WP_014635676.1 LacI family DNA-binding transcriptional regulator -
  DQL02_RS06920 (NCTC12067_01377) nusB 1374734..1375186 (-) 453 WP_002988501.1 transcription antitermination factor NusB -
  DQL02_RS06925 (NCTC12067_01378) - 1375179..1375568 (-) 390 WP_002983163.1 Asp23/Gls24 family envelope stress response protein -
  DQL02_RS06930 (NCTC12067_01379) efp 1375614..1376171 (-) 558 WP_002988496.1 elongation factor P -
  DQL02_RS06935 (NCTC12067_01380) - 1376267..1376728 (-) 462 WP_002988493.1 deoxycytidylate deaminase -
  DQL02_RS06940 (NCTC12067_01381) - 1376763..1377836 (-) 1074 WP_063510274.1 M24 family metallopeptidase -
  DQL02_RS06945 (NCTC12067_01382) uvrA 1377951..1380779 (-) 2829 WP_011054967.1 excinuclease ABC subunit UvrA Machinery gene
  DQL02_RS06950 (NCTC12067_01383) prx 1381006..1381188 (-) 183 WP_047149504.1 hypothetical protein Regulator
  DQL02_RS06955 (NCTC12067_01384) mf2 1381428..1382186 (+) 759 WP_011184727.1 DNase Mf2 -
  DQL02_RS06960 (NCTC12067_01385) speC 1382297..1383004 (+) 708 WP_002988478.1 streptococcal pyrogenic exotoxin SpeC -
  DQL02_RS06965 (NCTC12067_01386) - 1383072..1384274 (-) 1203 WP_021775297.1 glucosaminidase domain-containing protein -
  DQL02_RS06970 (NCTC12067_01388) - 1384387..1384572 (-) 186 WP_011184796.1 holin -
  DQL02_RS06975 (NCTC12067_01389) - 1384569..1384868 (-) 300 WP_011018110.1 hypothetical protein -
  DQL02_RS06980 (NCTC12067_01390) - 1384879..1385496 (-) 618 WP_029714007.1 DUF1366 domain-containing protein -

Sequence


Protein


Download         Length: 942 a.a.        Molecular weight: 104034.22 Da        Isoelectric Point: 6.0690

>NTDB_id=1019905 DQL02_RS06945 WP_011054967.1 1377951..1380779(-) (uvrA) [Streptococcus pyogenes strain NCTC12067]
MQNKIIIHGARAHNLKNIDVEIPRDKLVVVTGLSGSGKSSLAFDTIYAEGQRRYVESLSAYARQFLGNMEKPDVDSIDGL
SPAISIDQKTTSKNPRSTVGTVTEINDYLRLLYARVGTPYCINGHGAITASSAEQIVEQVLALPERTRMQILAPIVRRKK
GQHKTIFEKIQKDGYVRVRVDGDIFDVTEVPELSKSKMHNIEVVIDRLVNKDGIRSRLFDSVEAALRLGDGYLMIDTMDG
NELLFSEHYSCPVCGFTVPELEPRLFSFNAPFGSCPTCDGLGIKLEVDLDLVVPDPSKSLKEGALAPWNPISSNYYPTML
EQAMASFGVDMDTPFEALTEEERDLVLYGSGDREFHFHYVNDFGGERNIDIPFEGVVTNVNRRYHETNSDYTRNVMRGYM
NELTCATCHGYRLNDQALCVHVGGEEGPHIGQISELSIADHLQLLEELELTENESTIAKPIVKEIHDRLTFLNNVGLNYL
TLSRAAGTLSGGESQRIRLATQIGSNLSGVLYILDEPSIGLHQRDNDRLIESLKKMRDLGNTLIVVEHDEDTMMQADWLI
DVGPGAGEFGGEIIASGTPKQVAKNKKSITGQYLSGKKFIPVPLERRSGNGRFIEIKGAAQNNLQSLDVRFPLGKFIAVT
GVSGSGKSTLVNSILKKAVAQKLNRNADKPGKYHSISGIEHIERLIDIDQSPIGRTPRSNPATYTGVFDDIRDLFAQTNE
AKIRGYKKGRFSFNVKGGRCEACSGDGIIKIEMHFLPDVYVPCEVCHGRRYNSETLEVHYKEKNIAEVLDMTVDDALVFF
SAIPKIARKIQTIKDVGLGYVTLGQPATTLSGGEAQRMKLASELHKRSTGKSLYILDEPTTGLHTDDIARLLKVLERFVD
DGNTVLVIEHNLDVIKSADHIIDLGPEGGVGGGQIVATGTPEEVAQVKESYTGHYLKVKLQQ

Nucleotide


Download         Length: 2829 bp        

>NTDB_id=1019905 DQL02_RS06945 WP_011054967.1 1377951..1380779(-) (uvrA) [Streptococcus pyogenes strain NCTC12067]
ATGCAAAATAAAATAATAATTCATGGGGCAAGAGCCCACAATTTAAAAAATATTGACGTGGAAATTCCACGAGACAAATT
AGTTGTCGTGACAGGGTTATCAGGGTCAGGAAAATCTAGTCTAGCCTTTGATACTATTTATGCGGAAGGGCAACGTCGTT
ACGTAGAAAGTTTATCAGCTTATGCTAGACAGTTCTTGGGTAATATGGAAAAACCAGATGTGGATTCCATTGACGGTCTT
AGCCCTGCTATTTCCATTGATCAAAAAACTACCAGTAAGAACCCCCGCTCAACGGTTGGTACGGTTACGGAAATCAATGA
TTATTTACGTTTACTATATGCGCGTGTGGGCACACCTTACTGTATTAATGGGCATGGGGCCATTACAGCATCTTCTGCAG
AACAAATTGTAGAGCAGGTCTTAGCCCTCCCTGAACGGACACGCATGCAGATTTTAGCGCCTATTGTTCGCCGGAAAAAA
GGTCAACACAAAACCATTTTTGAGAAAATTCAAAAAGATGGTTATGTCCGTGTGCGGGTTGATGGGGATATTTTTGACGT
GACAGAAGTGCCGGAGCTGTCAAAAAGTAAGATGCACAACATCGAGGTGGTTATTGATCGTCTGGTTAATAAGGATGGTA
TTCGTAGCCGTTTATTTGATTCGGTTGAAGCAGCTTTAAGGCTGGGAGATGGCTACCTTATGATTGACACTATGGATGGC
AATGAACTGCTCTTTTCTGAGCATTATTCCTGTCCTGTCTGTGGGTTTACGGTTCCTGAATTAGAACCAAGACTCTTCTC
TTTTAATGCGCCGTTCGGCTCTTGTCCCACCTGTGATGGGCTAGGCATTAAGTTGGAAGTGGATTTGGACTTGGTTGTTC
CTGACCCAAGTAAGTCTTTGAAAGAGGGAGCTTTGGCGCCTTGGAATCCTATTTCCTCCAATTATTACCCAACCATGCTT
GAGCAAGCTATGGCAAGTTTTGGGGTGGATATGGATACACCTTTTGAGGCCTTGACTGAGGAAGAAAGGGATTTAGTGCT
TTATGGTTCAGGTGATAGAGAATTTCATTTTCACTATGTGAATGATTTTGGTGGTGAGCGTAACATTGACATTCCTTTTG
AAGGTGTTGTGACTAATGTTAATCGCCGTTATCACGAAACTAATAGTGATTATACGCGCAATGTGATGCGTGGCTACATG
AATGAATTGACTTGTGCGACTTGTCATGGTTACCGTTTGAATGACCAAGCCTTGTGTGTGCATGTGGGTGGCGAAGAAGG
ACCTCATATTGGTCAAATTTCAGAATTATCGATTGCCGACCACTTGCAGTTGTTGGAAGAACTGGAACTCACAGAAAATG
AAAGTACCATTGCTAAACCGATTGTCAAAGAAATTCATGACCGCCTGACCTTCTTAAATAATGTGGGACTGAATTATCTG
ACCTTATCACGTGCTGCTGGGACTTTATCAGGTGGGGAAAGTCAACGAATCAGGTTAGCGACACAAATTGGTTCTAACTT
ATCAGGGGTGCTCTATATCTTGGATGAGCCTTCTATTGGATTGCACCAAAGAGACAATGACCGTTTGATCGAAAGCCTGA
AAAAAATGCGTGATTTGGGTAATACCTTAATTGTGGTAGAACACGATGAAGACACCATGATGCAGGCAGACTGGTTGATT
GATGTGGGGCCTGGGGCAGGTGAGTTCGGTGGAGAAATTATTGCCTCTGGAACGCCGAAACAAGTGGCTAAGAATAAAAA
ATCCATCACGGGTCAATATTTGTCTGGTAAAAAATTCATTCCAGTGCCATTAGAGCGTCGTTCTGGTAATGGCCGATTCA
TTGAAATAAAAGGAGCAGCGCAGAATAATCTTCAAAGCCTCGACGTGAGATTCCCACTGGGTAAATTTATTGCGGTCACA
GGGGTATCAGGCTCAGGGAAATCAACCTTGGTTAATAGTATTTTGAAAAAGGCTGTCGCCCAAAAATTAAACCGTAATGC
TGATAAGCCTGGTAAATATCACTCTATTTCTGGTATTGAACATATTGAACGCTTGATTGACATTGACCAAAGTCCGATTG
GAAGGACGCCACGGTCAAATCCAGCCACCTATACGGGTGTCTTTGATGATATTCGAGACTTGTTTGCCCAAACCAACGAA
GCTAAGATTCGTGGTTACAAAAAAGGCCGTTTCTCTTTTAATGTCAAAGGTGGGCGTTGTGAGGCTTGTTCAGGTGATGG
GATTATCAAAATCGAAATGCACTTTTTGCCAGATGTTTATGTGCCTTGTGAGGTTTGCCACGGCAGACGGTATAATTCTG
AGACGCTTGAGGTGCATTATAAAGAAAAAAATATTGCTGAAGTGCTTGACATGACTGTGGATGATGCCTTGGTATTTTTC
TCTGCTATTCCTAAAATCGCTCGAAAAATTCAAACGATTAAGGATGTTGGACTTGGTTATGTGACCTTAGGTCAACCAGC
TACTACTCTATCTGGAGGAGAAGCGCAGCGGATGAAATTAGCTAGTGAATTGCACAAACGCTCGACAGGTAAGAGCTTGT
ATATCCTAGATGAGCCAACGACTGGTTTACACACAGATGATATTGCAAGGCTATTAAAAGTTTTGGAACGCTTTGTAGAC
GATGGTAATACGGTTCTTGTGATTGAGCATAATTTGGACGTTATCAAATCTGCTGACCATATTATTGACTTAGGACCAGA
AGGTGGTGTCGGAGGTGGTCAGATTGTTGCCACGGGGACACCAGAAGAGGTAGCTCAAGTTAAAGAAAGCTATACTGGTC
ATTATTTGAAAGTAAAACTACAACAATAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB P0CZ41

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

84.82

100

0.848

  uvrA Streptococcus pneumoniae TIGR4

84.82

100

0.848

  uvrA Streptococcus pneumoniae D39

84.82

100

0.848