Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   G9W34_RS00990 Genome accession   NZ_CP049852
Coordinates   218416..221238 (-) Length   940 a.a.
NCBI ID   WP_001774120.1    Uniprot ID   -
Organism   Escherichia coli strain UPEC-774U/190308     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 213416..226238
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  G9W34_RS00970 (G9W34_00975) - 214510..216330 (-) 1821 WP_219934324.1 ATP-binding protein -
  G9W34_RS00975 (G9W34_00980) aphA 216607..217320 (+) 714 WP_001226933.1 acid phosphatase AphA -
  G9W34_RS00980 (G9W34_00985) yjbQ 217431..217847 (+) 417 WP_000270369.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  G9W34_RS00985 (G9W34_00990) yjbR 217851..218207 (+) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  G9W34_RS00990 (G9W34_00995) uvrA 218416..221238 (-) 2823 WP_001774120.1 excinuclease ABC subunit UvrA Machinery gene
  G9W34_RS00995 (G9W34_01000) ssb 221493..222029 (+) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  G9W34_RS01000 (G9W34_01005) yjcB 222128..222409 (-) 282 WP_001296643.1 YjcB family protein -
  G9W34_RS01005 (G9W34_01010) pdeC 222838..224391 (+) 1554 WP_001540433.1 c-di-GMP phosphodiesterase PdeC -
  G9W34_RS01010 (G9W34_01015) soxS 224427..224750 (-) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  G9W34_RS01015 (G9W34_01020) soxR 224836..225300 (+) 465 WP_000412431.1 redox-sensitive transcriptional activator SoxR -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103922.57 Da        Isoelectric Point: 6.6337

>NTDB_id=375487 G9W34_RS00990 WP_001774120.1 218416..221238(-) (uvrA) [Escherichia coli strain UPEC-774U/190308]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLYARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSTNVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGHTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=375487 G9W34_RS00990 WP_001774120.1 218416..221238(-) (uvrA) [Escherichia coli strain UPEC-774U/190308]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTTAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAGAAGCCGGACGTCGACCATATTGAAGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGCTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTCTGCTGTACGCTCGCGTTGGTGAGCCACGCTGCCCGGACCACGATGTACCGCTGGCGGCGCAAACCGTCAGTC
AGATGGTGGATAACGTGTTGTCCCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAAGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAATTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAAGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTTGCCTGCCCGATTTGCGGTTACAGTATGCGCGAGCTGGAACCTCGCCT
GTTTTCATTTAACAACCCGGCGGGAGCCTGCCCGACCTGTGACGGTCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAGAATCCGGAATTGTCGCTGGCTGGCGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCACGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAATATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACGGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGTCCGTGCGCCAGCTGCGAAGGAACCCGTCTGCGTCGGGAAGCACGCCACGTGTATGTCGAGAATACGCC
GCTGCCCGCCATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCAGAAAAAATCCTTAAAGAGATCGGCGATCGTCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACACTT
TCCCGCTCGGCAGAGACACTTTCCGGCGGTGAAGCCCAGCGTATTCGTCTGGCGAGCCAGATTGGTGCAGGCCTGGTTGG
CGTGATGTACGTGCTGGATGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGATCATGTGATCGATATC
GGTCCGGGTGCGGGTGTTCACGGCGGTGAAGTGGTCGCGGAAGGTCCACTGGAAGCGATTATGGCGGTGCCTGAGTCGTT
GACCGGGCAGTACATGAGCGGTAAACGCAAGATTGAGGTGCCGAAGAAGCGCGTTCCGGCAAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGCAACAACCTGAAAGACGTGACGCTGACGCTGCCGGTGGGTCTGTTTACTTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGACTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACACCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGCGGCTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGACGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGACATTTACGTACCGTGCGACCAGTGCAAAGGCAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGCTGATGGATGTTGGCCTGACGTACATTCGCCTCGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCATACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAATACCATTGTGGTAATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCGGA
AGGCGGCAGTGGGGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCAGAGTGCGAAGCTTCGCATACGGCGC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.476

100

0.577

  uvrA Streptococcus pneumoniae TIGR4

57.476

100

0.577

  uvrA Streptococcus pneumoniae D39

57.476

100

0.577