Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   PWR57_RS00950 Genome accession   NZ_CP119441
Coordinates   200866..203688 (-) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli O121 strain 201805972     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 195866..208688
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  PWR57_RS00925 (PWR57_00925) tyrB 196931..198124 (+) 1194 WP_000486988.1 aromatic amino acid transaminase -
  PWR57_RS00930 (PWR57_00930) yjbS 198626..198829 (-) 204 WP_001321562.1 protein YjbS -
  PWR57_RS00935 (PWR57_00935) aphA 199231..199944 (+) 714 WP_001300837.1 acid phosphatase AphA -
  PWR57_RS00940 (PWR57_00940) yjbQ 200055..200471 (+) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  PWR57_RS00945 (PWR57_00945) yjbR 200475..200831 (+) 357 WP_000155655.1 MmcQ/YjbR family DNA-binding protein -
  PWR57_RS00950 (PWR57_00950) uvrA 200866..203688 (-) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  PWR57_RS00955 (PWR57_00955) ssb 203942..204478 (+) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  PWR57_RS00960 (PWR57_00960) yjcB 204577..204858 (-) 282 WP_001295689.1 YjcB family protein -
  PWR57_RS00965 (PWR57_00965) pdeC 205288..205956 (+) 669 Protein_183 c-di-GMP phosphodiesterase PdeC -
  PWR57_RS00970 (PWR57_00970) - 205999..206696 (+) 698 WP_094096600.1 IS1-like element IS1A family transposase -
  PWR57_RS00975 (PWR57_00975) pdeC 206709..207650 (+) 942 Protein_185 c-di-GMP phosphodiesterase PdeC -
  PWR57_RS00980 (PWR57_00980) soxS 207653..207976 (-) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  PWR57_RS00985 (PWR57_00985) soxR 208062..208526 (+) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=726436 PWR57_RS00950 WP_000357740.1 200866..203688(-) (uvrA) [Escherichia coli O121 strain 201805972]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=726436 PWR57_RS00950 WP_000357740.1 200866..203688(-) (uvrA) [Escherichia coli O121 strain 201805972]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGCGAACCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTTATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTGGCCGAGTCGTTTGAAACCGCGCTAGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCTAATTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGTGCCTGCCCGACCTGTGACGGCCTCGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAAAACCCGGAACTGTCGCTGGCAGGTGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTTCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TTGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACGGAGTCCAGCGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCATGCGCCAGCTGCGAAGGAACGCGTCTGCGTCGGGAAGCGCGCCACGTGTATGTCGAGAATACGCC
GCTGCCCGCCATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCGGAAAAAATTCTTAAAGAGATCGGCGATCGTTTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCATCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTTCACGGCGGTGAAGTGGTCGCGGAAGGTCCACTGGAAGCAATTATGGCGGTGCCGGAGTCGTT
AACCGGACAGTACATGAGCGGTAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGTAATAACCTGAAAGACGTGACGCTGACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGGGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGACTGGAGCATTTCGACAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGCCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGCGGCTATACGCCGGGACGTTTCAGCTTTAACGTTCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGATGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGACCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGACTGGGGCAGTCCGC
AACCACCCTTTCAGGCGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAACTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGTGGCGGCGAGATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCATCACACACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576