Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   QC809_RS21645 Genome accession   NZ_CP122499
Coordinates   4360371..4363193 (+) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli strain W409     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4355371..4368193
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  QC809_RS21620 soxR 4356309..4356773 (-) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -
  QC809_RS21625 soxS 4356859..4357182 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  QC809_RS21630 pdeC 4357185..4358771 (-) 1587 WP_000019531.1 c-di-GMP phosphodiesterase PdeC -
  QC809_RS21635 yjcB 4359201..4359482 (+) 282 WP_001295689.1 YjcB family protein -
  QC809_RS21640 ssb 4359581..4360117 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  QC809_RS21645 uvrA 4360371..4363193 (+) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  QC809_RS21650 yjbR 4363228..4363584 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  QC809_RS21655 yjbQ 4363588..4364004 (-) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  QC809_RS21660 aphA 4364115..4364807 (-) 693 WP_123000301.1 acid phosphatase AphA -
  QC809_RS21665 yjbS 4365230..4365433 (+) 204 WP_001321562.1 protein YjbS -
  QC809_RS21670 tyrB 4365935..4367128 (-) 1194 WP_000486985.1 aromatic amino acid transaminase -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=740758 QC809_RS21645 WP_000357740.1 4360371..4363193(+) (uvrA) [Escherichia coli strain W409]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=740758 QC809_RS21645 WP_000357740.1 4360371..4363193(+) (uvrA) [Escherichia coli strain W409]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTATTCGCCCGCGTTGGCGAGCCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTACTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGCTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCAAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCATTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCGGGGGCCTGCCCGACCTGCGACGGCCTTGGCGTACAGCAATATTTCGATCCTGATCGAG
TGATCCAGAATCCGGAACTGTCGCTGGCTGGTGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TCGAAGGCGTGCTGCATAATATGGAGCGCCGCTATAAAGAGACGGAATCCAGCGCGGTACGCGAAGAATTAGCCAAGTTT
ATCAGTAATCGTCCGTGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTGTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATTGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCAGAAAAAATCCTTAAAGAGATCGGCGATCGTCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCTGGCGGTGAAGCACAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCGTCTATCGGCCTGCACCAGCGTGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCAATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTTCACGGCGGTGAAGTGGTCGCAGAAGGTCCGCTGGAAGCGATTATGGCGGTGCCGGAGTCGTT
GACCGGGCAGTACATGAGCGGCAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGCAACAACCTGAAGGACGTGACGCTGACGCTGCCGGTGGGTCTGTTTACCTGCATCACCGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGGGCGACCAT
CGCCGAACCAGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCACGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGCCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGCGGCTATACGCCGGGACGTTTCAGCTTTAACGTTCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGATGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGACCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGACTGGGGCAGTCCGC
AACCACCCTTTCAGGCGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAACTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGTGGCGGCGAGATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCATCACACACGGCAC
GCTTCCTTAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576