Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   GUU82_RS21105 Genome accession   NZ_CP047658
Coordinates   4355907..4358729 (+) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli strain LD39-1     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4350907..4363729
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GUU82_RS21080 (GUU82_21085) soxR 4351844..4352308 (-) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -
  GUU82_RS21085 (GUU82_21090) soxS 4352394..4352717 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  GUU82_RS21090 (GUU82_21095) pdeC 4352720..4354306 (-) 1587 Protein_4184 c-di-GMP phosphodiesterase PdeC -
  GUU82_RS21095 (GUU82_21100) yjcB 4354736..4355017 (+) 282 WP_001295689.1 YjcB family protein -
  GUU82_RS21100 (GUU82_21105) ssb 4355116..4355652 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  GUU82_RS21105 (GUU82_21110) uvrA 4355907..4358729 (+) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  GUU82_RS21110 (GUU82_21115) yjbR 4358764..4359120 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  GUU82_RS21115 (GUU82_21120) yjbQ 4359124..4359540 (-) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  GUU82_RS21120 (GUU82_21125) aphA 4359651..4360364 (-) 714 WP_001315956.1 acid phosphatase AphA -
  GUU82_RS24750 - 4360766..4361152 (+) 387 WP_001339137.1 hypothetical protein -
  GUU82_RS21130 (GUU82_21135) tyrB 4361491..4362684 (-) 1194 WP_000486988.1 aromatic amino acid transaminase -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=360642 GUU82_RS21105 WP_000357740.1 4355907..4358729(+) (uvrA) [Escherichia coli strain LD39-1]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=360642 GUU82_RS21105 WP_000357740.1 4355907..4358729(+) (uvrA) [Escherichia coli strain LD39-1]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTTGGCGAGCCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTACTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGCTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCAAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCATTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCGGGGGCCTGCCCGACCTGCGACGGCCTTGGCGTACAGCAATATTTCGATCCTGATCGAG
TGATCCAGAATCCGGAACTGTCGCTGGCTGGTGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TCGAAGGCGTGCTGCATAATATGGAGCGCCGCTATAAAGAGACGGAATCCAGCGCGGTACGCGAAGAATTAGCCAAGTTT
ATCAGTAATCGTCCGTGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTGTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATTGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCAGAAAAAATCCTTAAAGAGATCGGCGATCGTCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCTGGCGGTGAAGCACAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCGTCTATCGGCCTGCACCAGCGTGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCAATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTTCACGGCGGTGAAGTGGTCGCAGAAGGTCCGCTGGAAGCGATTATGGCGGTGCCGGAGTCGTT
GACCGGGCAGTACATGAGCGGCAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGCAACAACCTGAAGGACGTGACGCTGACGCTGCCGGTGGGTCTGTTTACCTGCATCACCGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACGCTGTTCCCTATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGACAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACACCTGTGCGCGAACTTTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAAGCCTGTCAGGGCGACGG
TGTGATCAAAGTGGAGATGCACTTCCTGCCGGACATTTACGTACCGTGCGACCAGTGTAAAGGTAAACGCTATAACCGTG
AAACGCTGGAAATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGCCTGGGGCAGTCCGC
AACCACCCTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACACTGT
ATATTCTCGACGAGCCGACCACCGGTTTGCACTTCGCCGATATTCAGCAACTGCTCGACGTGCTGCATAAACTGCGCGAT
CAGGGCAATACCATTGTGGTAATTGAGCACAATCTCGACGTGATTAAAACCGCTGACTGGATTGTCGACCTGGGACCGGA
AGGCGGCAGTGGCGGCGGCGAGATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCGC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576


Multiple sequence alignment