Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   F4V41_RS11900 Genome accession   NZ_CP044143
Coordinates   2171742..2174564 (+) Length   940 a.a.
NCBI ID   WP_000357763.1    Uniprot ID   A0A0H2Z4Q6
Organism   Escherichia coli O157 strain AR-0429     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 2166742..2179564
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  F4V41_RS11875 soxR 2167680..2168144 (-) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -
  F4V41_RS11880 soxS 2168230..2168553 (+) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  F4V41_RS11885 pdeC 2168556..2170142 (-) 1587 WP_001016522.1 c-di-GMP phosphodiesterase PdeC -
  F4V41_RS11890 yjcB 2170571..2170852 (+) 282 WP_001295689.1 YjcB family protein -
  F4V41_RS11895 ssb 2170951..2171487 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  F4V41_RS11900 uvrA 2171742..2174564 (+) 2823 WP_000357763.1 excinuclease ABC subunit UvrA Machinery gene
  F4V41_RS11905 yjbR 2174599..2174955 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  F4V41_RS11910 yjbQ 2174959..2175375 (-) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  F4V41_RS11915 aphA 2175486..2176199 (-) 714 WP_001226923.1 acid phosphatase AphA -
  F4V41_RS11920 - 2176600..2176959 (+) 360 WP_001303754.1 hypothetical protein -
  F4V41_RS11925 tyrB 2177298..2178491 (-) 1194 WP_000486982.1 aromatic amino acid transaminase -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103883.54 Da        Isoelectric Point: 6.6065

>NTDB_id=340976 F4V41_RS11900 WP_000357763.1 2171742..2174564(+) (uvrA) [Escherichia coli O157 strain AR-0429]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLYARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=340976 F4V41_RS11900 WP_000357763.1 2171742..2174564(+) (uvrA) [Escherichia coli O157 strain AR-0429]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTACGCCCGCGTCGGCGAACCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACACACTATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTTTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGTGCCTGCCCGACCTGCGACGGCCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAGAATCCGGAACTGTCGCTGGCAGGTGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATCCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACAGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTC
ATCAGCAATCGCCCGTGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTGTATGTCGAGAATACGCC
GCTGCCCGCCATCTCCGACATGAGCATTGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGGGCGA
AGATTGCGGAAAAAATTCTTAAAGAGATCGGCGATCGTTTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGATGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGATCATGTGATCGATATC
GGTCCTGGTGCAGGTGTACATGGCGGTGAAGTGGTCGCGGAAGGTCCGCTGGAAGCGATTATGGCGGTGCCGGAGTCGTT
GACCGGACAGTACATGAGCGGTAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTACTTA
AGCTGACTGGCGCACGCGGCAACAACCTGAAAGACGTGACGCTAACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGACTGGAGCATTTCGACAAAGTAATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGCCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAGGCCTGTCAGGGCGATGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGACATTTACGTGCCGTGCGACCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGTCTGACGTACATTCGCTTGGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATTAAAACCGCTGACTGGATTGTCGACCTGGGGCCGGA
AGGCGGCAGTGGCGGCGGCGAGATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB A0A0H2Z4Q6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.476

100

0.577

  uvrA Streptococcus pneumoniae TIGR4

57.476

100

0.577

  uvrA Streptococcus pneumoniae D39

57.476

100

0.577