Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   LNN41_RS20700 Genome accession   NZ_CP086532
Coordinates   4256889..4259711 (+) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli strain Ec-042-T5-ESBL     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4251889..4264711
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  LNN41_RS20665 (LNN41_20655) soxR 4252051..4252515 (-) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -
  LNN41_RS20670 (LNN41_20660) soxS 4252601..4252924 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  LNN41_RS20675 (LNN41_20665) pdeC 4252927..4253646 (-) 720 Protein_4057 c-di-GMP phosphodiesterase PdeC -
  LNN41_RS20685 (LNN41_20675) pdeC 4254414..4255289 (-) 876 Protein_4059 c-di-GMP phosphodiesterase PdeC -
  LNN41_RS20690 (LNN41_20680) yjcB 4255719..4256000 (+) 282 WP_001295689.1 YjcB family protein -
  LNN41_RS20695 (LNN41_20685) ssb 4256099..4256635 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  LNN41_RS20700 (LNN41_20690) uvrA 4256889..4259711 (+) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  LNN41_RS20705 (LNN41_20695) yjbR 4259746..4260102 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  LNN41_RS20710 (LNN41_20700) yjbQ 4260106..4260522 (-) 417 WP_000270372.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  LNN41_RS20715 (LNN41_20705) aphA 4260633..4261346 (-) 714 WP_001307512.1 acid phosphatase AphA -
  LNN41_RS20720 (LNN41_20710) - 4261748..4261970 (+) 223 Protein_4066 hypothetical protein -
  LNN41_RS20725 (LNN41_20715) - 4262000..4262251 (+) 252 WP_000275035.1 hypothetical protein -
  LNN41_RS20730 (LNN41_20720) tyrB 4262473..4263666 (-) 1194 WP_000486996.1 aromatic amino acid transaminase -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=542850 LNN41_RS20700 WP_000357740.1 4256889..4259711(+) (uvrA) [Escherichia coli strain Ec-042-T5-ESBL]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=542850 LNN41_RS20700 WP_000357740.1 4256889..4259711(+) (uvrA) [Escherichia coli strain Ec-042-T5-ESBL]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGCGAACCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCGGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACAGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGTGCCTGCCCAACCTGTGACGGCCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAAAACCCCGAGCTGTCACTGGCTGGCGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTACTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATCCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACAGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCATGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTTTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTAGCTGGTCAGCGGGCGA
AGATTGCGGAAAAAATTCTTAAAGAGATCGGCGATCGCCTGAAATTCCTCGTAAACGTCGGCCTGAATTACCTGACACTT
TCCCGCTCGGCAGAAACACTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTATGTACTGGACGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCATGACGAAGACGCAATTCGCGCCGCTGACCATGTGATCGATATC
GGTCCTGGTGCGGGTGTTCACGGCGGTGAAGTGGTCGCAGAAGGTCCGCTGGAAGCGATTATGGCGGTGCCTGAATCGTT
GACCGGGCAGTACATGAGCGGTAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCAGAAAAAGTGCTGA
AGCTGACAGGTGCACGCGGCAACAACCTGAAGGACGTGACGCTCACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCACGTTCTAACCCGGCGACCTATACCGGCGTGTTTACACCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGGCGCTGCGAAGCCTGTCAGGGCGACGG
TGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGATCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAAATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGTCTGACGTACATTCGCCTGGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTCCTCGACGTGCTGCATAAACTGCGCGAT
CAGGGCAATACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGCGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576