Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrA   Type   Machinery gene
Locus tag   FZN31_RS22165 Genome accession   NZ_CP043414
Coordinates   4694614..4697436 (+) Length   940 a.a.
NCBI ID   WP_032185682.1    Uniprot ID   -
Organism   Escherichia coli strain EC42405     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4689614..4702436
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  FZN31_RS22145 (FZN31_22540) - 4690151..4691080 (+) 930 WP_000607107.1 dihydrodipicolinate synthase family protein -
  FZN31_RS22150 (FZN31_22545) - 4691352..4692233 (+) 882 WP_105288239.1 fumarylacetoacetate hydrolase family protein -
  FZN31_RS22155 (FZN31_22550) - 4692324..4693610 (+) 1287 WP_105288238.1 anaerobic C4-dicarboxylate transporter family protein -
  FZN31_RS22160 (FZN31_22555) ssb 4693823..4694359 (-) 537 WP_000168305.1 single-stranded DNA-binding protein SSB1 Machinery gene
  FZN31_RS22165 (FZN31_22560) uvrA 4694614..4697436 (+) 2823 WP_032185682.1 excinuclease ABC subunit UvrA Machinery gene
  FZN31_RS22170 (FZN31_22565) yjbR 4697471..4697827 (-) 357 WP_000155657.1 MmcQ/YjbR family DNA-binding protein -
  FZN31_RS22175 (FZN31_22570) yjbQ 4697831..4698247 (-) 417 WP_000270364.1 secondary thiamine-phosphate synthase enzyme YjbQ -
  FZN31_RS22180 (FZN31_22575) aphA 4698358..4699071 (-) 714 WP_105288237.1 acid phosphatase AphA -
  FZN31_RS22185 (FZN31_22585) tyrB 4699408..4700601 (-) 1194 WP_105288236.1 aromatic amino acid transaminase -
  FZN31_RS22190 (FZN31_22590) alr 4700853..4701932 (-) 1080 WP_001147343.1 alanine racemase -

Sequence


Protein


Download         Length: 940 a.a.        Molecular weight: 103809.50 Da        Isoelectric Point: 6.6711

>NTDB_id=337046 FZN31_RS22165 WP_032185682.1 4694614..4697436(+) (uvrA) [Escherichia coli strain EC42405]
MDKIEVRGARTHNLKNINLVIPRDKLIVVTGLSGSGKSSLAFDTLYAEGQRRYVESLSAYARQFLSLMEKPDVDHIEGLS
PAISIEQKSTSHNPRSTVGTITEIHDYLRLLFARVGEPRCPDHDVPLAAQTVSQMVDNVLSQPEGKRLMLLAPIIKERKG
EHTKTLENLASQGYIRARIDGEVCDLSDPPKLELQKKHTIEVVVDRFKVRDDLTQRLAESFETALELSGGTAVVADMDDP
KAEELLFSANFACPICGYSMRELEPRLFSFNNPAGACPTCDGLGVQQYFDPDRVIQNPELSLAGGAIRGWDRRNFYYFQM
LKSLADHYKFDVEAPWGSLSANVHKVVLYGSGKENIEFKYMNDRGDTSIRRHPFEGVLHNMERRYKETESSAVREELAKF
ISNRPCASCEGTRLRREARHVYVENTPLPAISDMSIGHAMEFFNNLKLAGQRAKIAEKILKEIGDRLKFLVNVGLNYLTL
SRSAETLSGGEAQRIRLASQIGAGLVGVMYVLDEPSIGLHQRDNERLLGTLIHLRDLGNTVIVVEHDEDAIRAADHVIDI
GPGAGVHGGEVVAEGPLEAIMAVPESLTGQYMSGKRKIEVPKKRVPANPEKVLKLTGARGNNLKDVTLTLPVGLFTCITG
VSGSGKSTLINDTLFPIAQRQLNGATIAEPAPYRDIQGLEHFDKVIDIDQSPIGRTPRSNPATYTGVFTPVRELFAGVPE
SRARGYTPGRFSFNVRGGRCEACQGDGVIKVEMHFLPDIYVPCDQCKGKRYNRETLEIKYKGKTIHEVLDMTIEEAREFF
DAVPALARKLQTLMDVGLTYIRLGQSATTLSGGEAQRVKLARELSKRGTGQTLYILDEPTTGLHFADIQQLLDVLHKLRD
QGNTIVVIEHNLDVIKTADWIVDLGPEGGSGGGEILVSGTPETVAECAASHTARFLKPML

Nucleotide


Download         Length: 2823 bp        

>NTDB_id=337046 FZN31_RS22165 WP_032185682.1 4694614..4697436(+) (uvrA) [Escherichia coli strain EC42405]
ATGGATAAGATCGAAGTTCGGGGCGCCCGCACCCATAATCTCAAAAACATCAACCTCGTTATCCCCCGCGACAAGCTCAT
TGTCGTGACCGGGCTTTCGGGTTCTGGCAAATCCTCGCTCGCTTTCGACACCTTATATGCCGAAGGGCAGCGCCGTTACG
TTGAATCCCTTTCCGCCTACGCGCGGCAGTTTCTGTCACTGATGGAAAAGCCGGACGTCGATCATATTGAAGGGCTTTCT
CCTGCCATCTCGATTGAGCAGAAATCGACGTCTCATAACCCGCGTTCTACGGTGGGGACAATCACCGAAATCCACGACTA
TTTGCGTTTGTTGTTCGCCCGCGTCGGTGAGCCGCGCTGCCCGGACCACGATGTACCGCTGGCGGCGCAAACCGTCAGCC
AGATGGTGGATAACGTGCTGTCGCAGCCGGAAGGCAAGCGTCTGATGCTGCTCGCGCCAATCATTAAAGAGCGCAAAGGC
GAACACACCAAAACGCTGGAGAACCTGGCAAGCCAGGGTTACATCCGTGCTCGTATTGATGGCGAAGTCTGCGATCTTTC
CGATCCGCCGAAACTGGAACTGCAAAAGAAACATACCATTGAAGTGGTGGTTGATCGCTTCAAGGTGCGTGACGATCTCA
CCCAACGTCTGGCAGAGTCGTTTGAAACCGCGCTGGAGCTTTCCGGTGGTACCGCGGTAGTTGCCGATATGGACGATCCA
AAAGCGGAAGAGCTGCTATTTTCCGCCAACTTCGCCTGCCCAATTTGCGGCTACAGTATGCGTGAACTGGAACCACGCCT
GTTTTCGTTTAACAACCCGGCGGGTGCCTGCCCGACCTGTGACGGCCTTGGCGTACAGCAATATTTCGATCCTGATCGCG
TGATCCAAAACCCGGAACTGTCGCTGGCTGGCGGTGCGATCCGAGGCTGGGATCGCCGCAACTTCTATTATTTCCAGATG
CTGAAATCGCTGGCAGATCACTATAAGTTCGACGTCGAAGCGCCGTGGGGCAGCCTTAGCGCGAACGTGCATAAAGTGGT
GCTGTACGGTTCAGGCAAAGAAAACATTGAATTCAAATACATGAACGATCGCGGCGATACCTCCATTCGTCGTCATCCGT
TTGAAGGCGTGCTGCACAATATGGAGCGCCGTTATAAAGAGACGGAATCCAGTGCGGTACGCGAAGAATTAGCCAAGTTT
ATCAGCAATCGCCCGTGCGCCAGCTGCGAAGGAACGCGTCTGCGTCGGGAAGCGCGCCATGTGTATGTCGAGAATACGCC
GCTGCCTGCTATCTCCGACATGAGCATCGGTCATGCGATGGAATTCTTCAACAATCTCAAACTCGCAGGTCAACGAGCGA
AGATTGCGGAAAAAATTCTTAAGGAGATTGGCGATCGCCTGAAATTCCTCGTTAACGTCGGCCTGAATTACCTGACACTT
TCCCGCTCGGCAGAAACGCTTTCTGGCGGTGAAGCCCAGCGTATCCGTCTGGCGAGCCAGATTGGTGCGGGCCTGGTTGG
CGTGATGTACGTGCTGGATGAGCCGTCTATCGGCCTGCACCAGCGCGATAACGAGCGCCTGCTGGGTACGCTTATCCATC
TGCGCGATCTCGGTAATACCGTGATTGTGGTGGAGCACGACGAAGACGCGATTCGCGCCGCTGACCATGTGATCGACATT
GGCCCGGGCGCAGGTGTACACGGCGGTGAAGTAGTCGCGGAAGGTCCCCTGGAAGCGATTATGGCGGTGCCTGAGTCGTT
AACCGGGCAGTACATGAGCGGCAAACGCAAGATTGAAGTGCCGAAGAAACGCGTTCCGGCGAATCCGGAAAAAGTGCTGA
AGCTGACAGGCGCACGTGGTAATAACCTGAAAGACGTGACGCTGACGCTGCCAGTCGGTCTGTTTACCTGCATCACAGGG
GTTTCAGGTTCCGGTAAATCGACGCTGATTAACGACACACTGTTCCCGATTGCCCAACGCCAGTTGAATGGTGCGACCAT
CGCCGAACCGGCACCTTATCGCGATATTCAGGGGCTGGAGCATTTCGATAAAGTGATCGATATCGACCAAAGCCCAATTG
GTCGTACTCCGCGTTCTAACCCGGCGACTTATACTGGCGTGTTTACGCCTGTACGTGAACTGTTTGCGGGCGTACCGGAA
TCCCGTGCGCGTGGTTATACGCCAGGACGTTTCAGCTTTAACGTCCGTGGCGGACGCTGCGAAGCCTGTCAGGGCGACGG
CGTGATCAAAGTGGAGATGCACTTCCTGCCGGACATTTACGTACCGTGCGACCAGTGCAAAGGTAAACGCTATAACCGTG
AAACGCTGGAGATTAAGTACAAAGGCAAAACCATCCACGAAGTGCTGGATATGACCATCGAAGAGGCGCGTGAGTTCTTT
GATGCGGTGCCAGCTCTGGCGCGTAAGCTGCAAACGTTGATGGACGTTGGCCTGACGTACATTCGCCTCGGGCAGTCCGC
AACCACGCTTTCTGGTGGTGAAGCCCAGCGCGTGAAGCTGGCGCGTGAGCTGTCAAAACGCGGCACCGGGCAGACACTGT
ATATTCTCGACGAGCCGACCACCGGTCTGCACTTCGCCGATATTCAGCAACTGCTCGACGTACTGCATAAACTGCGCGAT
CAGGGCAATACCATCGTGGTGATTGAGCACAATCTCGACGTGATCAAAACCGCTGACTGGATTGTCGACCTGGGACCGGA
AGGCGGCAGTGGCGGCGGCGAGATCCTCGTCTCCGGTACACCAGAAACCGTCGCGGAGTGCGCAGCATCACACACGGCAC
GCTTCCTTAAGCCGATGCTGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrA Streptococcus pneumoniae R6

57.264

100

0.574

  uvrA Streptococcus pneumoniae TIGR4

57.264

100

0.574

  uvrA Streptococcus pneumoniae D39

57.264

100

0.574


Multiple sequence alignment