Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   AB6N08_RS17695 Genome accession   NZ_CP163448
Coordinates   3613802..3616624 (-) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli O102:H6 strain M2021_10044824_1_E     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 3608802..3621624
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  AB6N08_RS17670 (AB6N08_17665) tyrB 3609848..3611041 (+) 1194 WP_001522223.1 aromatic amino acid transaminase -
  AB6N08_RS17675 (AB6N08_17670) - 3611544..3611766 (-) 223 Protein_3446 hypothetical protein -
  AB6N08_RS17680 (AB6N08_17675) aphA 3612167..3612880 (+) 714 WP_001226928.1 acid phosphatase AphA -
  AB6N08_RS17685 (AB6N08_17680) yjbQ 3612991..3613407 (+) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  AB6N08_RS17690 (AB6N08_17685) yjbR 3613411..3613767 (+) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  AB6N08_RS17695 (AB6N08_17690) uvrA 3613802..3616624 (-) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  AB6N08_RS17700 (AB6N08_17695) ssb 3616879..3617415 (+) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  AB6N08_RS17705 (AB6N08_17700) tnpA 3617589..3618047 (-) 459 WP_000526135.1 IS200/IS605-like element IS200C family transposase -
  AB6N08_RS17710 (AB6N08_17705) yjcB 3618226..3618507 (-) 282 WP_001295689.1 YjcB family protein -
  AB6N08_RS17715 (AB6N08_17710) pdeC 3618937..3620523 (+) 1587 WP_001550430.1 c-di-GMP phosphodiesterase PdeC -
  AB6N08_RS17720 (AB6N08_17715) soxS 3620526..3620849 (-) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  AB6N08_RS17725 (AB6N08_17720) soxR 3620935..3621399 (+) 465 WP_000412424.1 redox-sensitive transcriptional activator SoxR -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=925958 AB6N08_RS17695 WP_000357740.1 3613802..3616624(-) (uvrA) [Escherichia coli O102:H6 strain M2021_10044824_1_E]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=925958 AB6N08_RS17695 WP_000357740.1 3613802..3616624(-) (uvrA) [Escherichia coli O102:H6 strain M2021_10044824_1_E]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGTGAGCCGCGCTGCCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGTC
AGATGGTGGATAACGTGTTGTCCCAGCCGGAAGGTAAACGCCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGTCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCCGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTTGCGGATATGGACGACCCG
AAAGCGGAAGAGTTGCTGTTCTCCGCTAATTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGGGCCTGCCCGACCTGTGACGGCCTTGGCGTGCAGCAATATTTCGATCCTGACCGCG
TGATCCAGAATCCGGAACTGTCGCTGGCTGGCGGTGCGATCCGAGGCTGGGATCGCCGCAACTTCTATTACTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATTCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACGGAATCCAGTGCGGTACGCGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCGTGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGAGAAGCGCGCCATGTGTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAGCGAGCGA
AGATTGCGGAAAAAATTCTTAAAGAGATTGGCGATCGCCTGAAATTCCTCGTTAACGTAGGCCTGAATTACCTGACACTT
TCCCGCTCGGCAGAGACACTTTCTGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTACACGGCGGTGAAGTGGTCGCAGAAGGTCCACTGGAAGCGATTATGGCAGTGCCTGAGTCGTT
GACCGGGCAGTACATGAGCGGCAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGTGGTAATAACCTGAAAGACGTGACGCTGACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGCCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAAGCCTGTCAGGGCGACGG
TGTGATCAAAGTGGAGATGCACTTCCTGCCGGATATCTACGTACCGTGCGACCAGTGCAAAGGCAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGTCTGACGTACATTCGCCTGGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTTGATGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCGGA
AGGCGGCAGTGGCGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576