Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   QYF42_RS22540 Genome accession   NZ_CP129259
Coordinates   4553782..4556604 (+) Length   940 a.a.
NCBI ID   WP_301002468.1    Uniprot ID   -
Organism   Escherichia coli strain STEC1587     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4548782..4561604
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  QYF42_RS22515 (QYF42_22515) soxR 4549720..4550184 (-) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -
  QYF42_RS22520 (QYF42_22520) soxS 4550270..4550593 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  QYF42_RS22525 (QYF42_22525) pdeC 4550596..4552182 (-) 1587 WP_000019536.1 c-di-GMP phosphodiesterase PdeC -
  QYF42_RS22530 (QYF42_22530) yjcB 4552612..4552893 (+) 282 WP_001295689.1 YjcB family protein -
  QYF42_RS22535 (QYF42_22535) ssb 4552992..4553528 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  QYF42_RS22540 (QYF42_22540) uvrA 4553782..4556604 (+) 2823 WP_301002468.1 excinuclease ABC subunit UvrA Machinery gene
  QYF42_RS22545 (QYF42_22545) yjbR 4556639..4556995 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  QYF42_RS22550 (QYF42_22550) yjbQ 4556999..4557415 (-) 417 WP_000270372.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  QYF42_RS22555 (QYF42_22555) - 4557526..4557753 (-) 228 Protein_4428 HAD family acid phosphatase -
  QYF42_RS22560 (QYF42_22560) - 4557820..4558982 (+) 1163 WP_085947771.1 IS3-like element IS3 family transposase -
  QYF42_RS22565 (QYF42_22565) aphA 4559012..4559500 (-) 489 Protein_4430 acid phosphatase AphA -
  QYF42_RS22570 (QYF42_22570) - 4559902..4560124 (+) 223 Protein_4431 hypothetical protein -
  QYF42_RS22575 (QYF42_22575) - 4560154..4560405 (+) 252 WP_000275035.1 hypothetical protein -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=777794 QYF42_RS22540 WP_301002468.1 4553782..4556604(+) (uvrA) [Escherichia coli strain STEC1587]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVLDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=777794 QYF42_RS22540 WP_301002468.1 4553782..4556604(+) (uvrA) [Escherichia coli strain STEC1587]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGCGAACCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACACACTATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCGGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACAGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGTGCCTGCCCGACCTGTGACGGCCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAAAACCCCGAGCTGTCACTGGCTGGCGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATCCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACAGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCATGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTTTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTAGCTGGTCAGCGGGCGA
AGATTGCAGAAAAAATCCTTAAAGAGATCGGCGATCGTCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACACTT
TCCCGCTCGGCAGAAACACTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTATGTACTGGACGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCATGACGAAGACGCAATTCGCGCCGCTGACCATGTGATCGATATC
GGTCCTGGTGCGGGTGTTCACGGCGGTGAAGTGGTCGCAGAAGGTCCGCTGGAAGCGATTATGGCAGTGCCTGAATCGTT
GACCGGGCAGTACATGAGCGGTAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCAGAAAAAGTGCTGA
AGCTGACAGGTGCACGCGGCAACAACCTGAAGGACGTGACGCTCACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGCTCGATATCGACCAAAGCCCAATTG
GTCGTACTCCACGTTCTAACCCGGCGACCTATACCGGCGTGTTTACACCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGGCGCTGCGAAGCCTGTCAGGGCGACGG
TGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGATCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAAATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGTCTGACGTACATTCGCCTGGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTCCTCGACGTGCTGCATAAACTGCGCGAT
CAGGGCAATACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGCGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.264

100

0.574

  uvrA Streptococcus pneumoniae TIGR4

57.264

100

0.574

  uvrA Streptococcus pneumoniae D39

57.264

100

0.574