Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   MS6193_RS21755 Genome accession   NZ_CP047405
Coordinates   4511269..4514091 (-) Length   940 a.a.
NCBI ID   WP_000357740.1    Uniprot ID   Q3YUS6
Organism   Escherichia coli strain MS6193     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4506269..4519091
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  MS6193_RS21730 (MS6193_04456) tyrB 4507314..4508507 (+) 1194 WP_000486994.1 aromatic amino acid transaminase -
  MS6193_RS25505 - 4508729..4508980 (-) 252 WP_000275035.1 hypothetical protein -
  MS6193_RS25510 - 4509010..4509232 (-) 223 Protein_4281 hypothetical protein -
  MS6193_RS21740 (MS6193_04458) aphA 4509634..4510347 (+) 714 WP_001307512.1 acid phosphatase AphA -
  MS6193_RS21745 (MS6193_04459) yjbQ 4510458..4510874 (+) 417 WP_000270375.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  MS6193_RS21750 (MS6193_04460) yjbR 4510878..4511234 (+) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  MS6193_RS21755 (MS6193_04461) uvrA 4511269..4514091 (-) 2823 WP_000357740.1 excinuclease ABC subunit UvrA Machinery gene
  MS6193_RS21760 (MS6193_04462) ssb 4514345..4514881 (+) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  MS6193_RS21765 (MS6193_04463) yjcB 4514980..4515261 (-) 282 WP_001295689.1 YjcB family protein -
  MS6193_RS21770 (MS6193_04464) pdeC 4515691..4517277 (+) 1587 WP_000019539.1 c-di-GMP phosphodiesterase PdeC -
  MS6193_RS21775 (MS6193_04465) soxS 4517280..4517603 (-) 324 WP_000019358.1 superoxide response transcriptional regulator SoxS -
  MS6193_RS21780 (MS6193_04466) soxR 4517689..4518153 (+) 465 WP_000412428.1 redox-sensitive transcriptional activator SoxR -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103867.54 Da        Isoelectric Point: 6.6066

>NTDB_id=359563 MS6193_RS21755 WP_000357740.1 4511269..4514091(-) (uvrA) [Escherichia coli strain MS6193]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECEASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=359563 MS6193_RS21755 WP_000357740.1 4511269..4514091(-) (uvrA) [Escherichia coli strain MS6193]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAGGGGCTTTCT
CCTGCCATCTCAATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATTCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGCGAACCGCGCTGTCCGGACCACGACGTCCCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTTA
CCCAACGTCTTGCGGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACAGCGGTAGTGGCGGATATGGACGACCCG
AAAGCGGAAGAGCTGCTGTTCTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAGCCGCGACT
GTTTTCGTTTAACAACCCGGCAGGTGCCTGCCCGACCTGTGACGGCCTTGGCGTACAGCAATATTTCGATCCTGACCGCG
TGATCCAAAACCCCGAGCTGTCACTGGCTGGCGGTGCGATCCGTGGCTGGGATCGCCGCAACTTCTATTACTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTGAGCGCGAACGTGCATAAAGTGGT
GTTGTACGGTTCTGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGTGGCGATACCTCCATCCGTCGTCATCCGT
TCGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACAGAATCCAGTGCGGTACGTGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCATGCGCCAGCTGCGAAGGGACGCGTCTGCGTCGGGAAGCGCGCCACGTTTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCTGGTCAACGGGCGA
AGATTGCGGAAAAAATCCTTAAAGAGATCGGCGATCGTTTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACGCTT
TCCCGCTCGGCAGAAACGCTTTCCGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTTATGTACGTGCTGGACGAGCCATCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGTTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCAATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTTCACGGCGGTGAAGTGGTCGCAGAAGGTCCGCTGGAAGCGATTATGGCGGTGCCGGAGTCGTT
GACCGGGCAGTACATGAGCGGCAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGCGGCAACAACCTGAAGGACGTGACGCTGACGCTGCCGGTGGGTCTGTTTACCTGCATCACCGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGGGCGACCAT
CGCCGAACCAGCACCGTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCACGTTCTAACCCGGCGACCTATACCGGCGTGTTTACGCCTGTGCGCGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGGCGCTGCGAAGCCTGTCAGGGCGACGG
TGTGATCAAAGTAGAGATGCACTTCCTGCCGGATATCTACGTGCCGTGCGATCAGTGTAAAGGTAAACGCTATAACCGTG
AAACGCTGGAAATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCCGTACCTGCACTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGCCTGGGGCAGTCCGC
AACCACACTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACGCTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAACACCATTGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCAGA
AGGCGGCAGTGGCGGCGGCGAAATCCTCGTCTCCGGTACGCCAGAAACCGTCGCGGAGTGCGAAGCTTCGCATACGGCAC
GCTTCCTCAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q3YUS6

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.37

100

0.576

  uvrA Streptococcus pneumoniae TIGR4

57.37

100

0.576

  uvrA Streptococcus pneumoniae D39

57.37

100

0.576