Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   PQS35_RS20600 Genome accession   NZ_CP117044
Coordinates   4242654..4245476 (-) Length   940 a.a.
NCBI ID   WP_000357744.1    Uniprot ID   -
Organism   Escherichia coli strain B-DolR     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4237654..4250476
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  PQS35_RS20575 tyrB 4238719..4239912 (+) 1194 WP_000486988.1 aromatic amino acid transaminase -
  PQS35_RS20580 yjbS 4240414..4240617 (-) 204 WP_001321562.1 protein YjbS -
  PQS35_RS20585 aphA 4241019..4241732 (+) 714 WP_001395166.1 acid phosphatase AphA -
  PQS35_RS20590 yjbQ 4241843..4242259 (+) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  PQS35_RS20595 yjbR 4242263..4242619 (+) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  PQS35_RS20600 uvrA 4242654..4245476 (-) 2823 WP_000357744.1 excinuclease ABC subunit UvrA Machinery gene
  PQS35_RS20605 ssb 4245731..4246267 (+) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  PQS35_RS20610 yjcB 4246366..4246647 (-) 282 WP_001295689.1 YjcB family protein -
  PQS35_RS20615 pdeC 4247077..4248663 (+) 1587 WP_000019548.1 c-di-GMP phosphodiesterase PdeC -
  PQS35_RS20620 soxS 4248666..4248989 (-) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  PQS35_RS20625 soxR 4249075..4249539 (+) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103857.50 Da        Isoelectric Point: 6.6066

>NTDB_id=716638 PQS35_RS20600 WP_000357744.1 4242654..4245476(-) (uvrA) [Escherichia coli strain B-DolR]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTSVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=716638 PQS35_RS20600 WP_000357744.1 4242654..4245476(-) (uvrA) [Escherichia coli strain B-DolR]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTTGGCGAGCCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTACTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGCTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTGGCCGAGTCGTTTGAAACCGCGCTAGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGTTACAGTATGCGCGAGCTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCGGGGGCCTGCCCGACCTGCGACGGCCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAGAATCCGGAACTGTCGCTGGCAGGTGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCACTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCTTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATCCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACAGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCATGCGCCAGCTGCGAAGGAACGCGTCTGCGTCGGGAAGCGCGCCACGTGTATGTCGAGAATACGCC
GCTGCCCGCCATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCGGAAAAAATTCTTAAAGAGATCGGCGATCGTTTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCATCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTTCACGGCGGTGAAGTGGTCGCGGAAGGTCCACTGGAAGCAATTATGGCGGTGCCGGAGTCGTT
AACCGGACAGTACATGAGCGGTAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGTAATAACCTGAAAGACGTGACGCTGACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGGGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGACTGGAGCATTTCGACAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGTCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGCGGCTATACGCCGGGACGTTTCAGCTTTAACGTTCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGATGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGACCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGACTGGGGCAGTCCGC
AACCACCCTTTCAGGCGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAACTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGTGGCGGCGAGATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCATCACACACGGCAC
GCTTCCTTAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576