Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   WCU26_RS22680 Genome accession   NZ_CP147567
Coordinates   4606090..4608912 (+) Length   940 a.a.
NCBI ID   WP_000357763.1    Uniprot ID   A0A0H2Z4Q6
Organism   Escherichia coli strain GN02100     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4601090..4613912
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  WCU26_RS22655 (WCU26_22655) soxR 4602029..4602493 (-) 465 WP_000412431.1 redox-sensitive transcriptional activator SoxR -
  WCU26_RS22660 (WCU26_22660) soxS 4602579..4602902 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  WCU26_RS22665 (WCU26_22665) pdeC 4602905..4604491 (-) 1587 WP_001314348.1 c-di-GMP phosphodiesterase PdeC -
  WCU26_RS22670 (WCU26_22670) yjcB 4604920..4605201 (+) 282 WP_001296643.1 YjcB family protein -
  WCU26_RS22675 (WCU26_22675) ssb 4605300..4605836 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  WCU26_RS22680 (WCU26_22680) uvrA 4606090..4608912 (+) 2823 WP_000357763.1 excinuclease ABC subunit UvrA Machinery gene
  WCU26_RS22685 (WCU26_22685) yjbR 4608947..4609303 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  WCU26_RS22690 (WCU26_22690) yjbQ 4609307..4609723 (-) 417 WP_000270369.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  WCU26_RS22695 (WCU26_22695) aphA 4609834..4610547 (-) 714 WP_001226933.1 acid phosphatase AphA -
  WCU26_RS22700 (WCU26_22700) - 4610824..4612644 (+) 1821 WP_000704415.1 ATP-binding protein -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103883.54 Da        Isoelectric Point: 6.6065

>NTDB_id=861097 WCU26_RS22680 WP_000357763.1 4606090..4608912(+) (uvrA) [Escherichia coli strain GN02100]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLYARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=861097 WCU26_RS22680 WP_000357763.1 4606090..4608912(+) (uvrA) [Escherichia coli strain GN02100]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTTAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAGAAGCCGGACGTCGACCATATTGAAGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGCTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTCTGCTGTACGCTCGCGTTGGTGAGCCGCGCTGCCCGGACCACGATGTACCGCTGGCGGCGCAAACCGTCAGTC
AGATGGTGGATAACGTGTTGTCCCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAAGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTTGCCTGCCCGATTTGCGGTTACAGTATGCGCGAGCTGGAACCTCGCCT
GTTTTCATTTAACAACCCGGCGGGAGCCTGCCCGACCTGTGACGGTCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAGAATCCGGAATTGTCGCTGGCTGGCGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACGGAATCCAGCGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGTCCGTGCGCCAGCTGCGAAGGAACCCGTCTGCGTCGGGAAGCACGCCACGTGTATGTCGAGAATACGCC
GCTGCCCGCCATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCAGAAAAAATCCTTAAAGAGATCGGCGATCGTCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACACTT
TCCCGCTCAGCAGAGACACTTTCCGGCGGTGAAGCCCAGCGTATTCGTCTGGCGAGCCAGATTGGTGCAGGCCTGGTTGG
CGTGATGTACGTGCTGGATGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGATCATGTGATCGATATC
GGTCCGGGTGCGGGTGTTCACGGCGGTGAAGTGGTCGCGGAAGGTCCACTGGAAGCGATTATGGCGGTGCCTGAGTCGTT
GACCGGGCAGTACATGAGCGGTAAACGCAAGATTGAGGTGCCGAAGAAACGCGTACCCGCCAATCCAGAAAAAGTGCTGA
AACTGACGGGCGCACGCGGCAACAACCTGAAAGACGTGACGCTGACGCTGCCGGTAGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGACTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACACCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGCGGCTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGACGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGACATTTACGTACCGTGCGACCAGTGCAAAGGCAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGCCTCGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAATACCATTGTGGTAATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCGGA
AGGCGGCAGTGGGGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCAGAGTGCGAAGCTTCGCATACGGCGC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB A0A0H2Z4Q6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.476

100

0.577

  uvrA Streptococcus pneumoniae TIGR4

57.476

100

0.577

  uvrA Streptococcus pneumoniae D39

57.476

100

0.577