Detailed information    

insolico Bioinformatically predicted

Overview


Name   uvrB   Type   Machinery gene
Locus tag   CG010_RS08275 Genome accession   NZ_CP042274
Coordinates   1649476..1652442 (+) Length   988 a.a.
NCBI ID   WP_099086079.1    Uniprot ID   -
Organism   Agrobacterium tumefaciens strain 186     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1644476..1657442
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  CG010_RS08240 (CG010_008560) - 1644686..1645090 (+) 405 WP_099086082.1 DUF2946 family protein -
  CG010_RS08245 (CG010_008565) - 1645138..1646502 (+) 1365 WP_099086081.1 PepSY domain-containing protein -
  CG010_RS08250 (CG010_008570) - 1646571..1647047 (-) 477 WP_099086080.1 nuclear transport factor 2 family protein -
  CG010_RS08255 (CG010_008575) - 1647060..1647671 (-) 612 WP_003507632.1 NAD(P)-dependent oxidoreductase -
  CG010_RS08260 (CG010_008580) - 1647826..1648209 (+) 384 WP_003507622.1 helix-turn-helix domain-containing protein -
  CG010_RS08265 (CG010_008585) - 1648327..1648749 (-) 423 WP_003507621.1 GNAT family N-acetyltransferase -
  CG010_RS08270 (CG010_008590) - 1648856..1649209 (-) 354 WP_020009373.1 DMT family protein -
  CG010_RS08275 (CG010_008595) uvrB 1649476..1652442 (+) 2967 WP_099086079.1 excinuclease ABC subunit UvrB Machinery gene
  CG010_RS08280 (CG010_008600) - 1652462..1652995 (-) 534 WP_223564864.1 hypothetical protein -
  CG010_RS08285 (CG010_008605) - 1653252..1654220 (+) 969 WP_020009370.1 alpha/beta hydrolase family protein -
  CG010_RS08290 (CG010_008610) - 1654248..1654673 (-) 426 WP_020009369.1 DUF1801 domain-containing protein -
  CG010_RS08295 (CG010_008615) - 1654837..1655292 (+) 456 WP_020009368.1 PRC-barrel domain-containing protein -
  CG010_RS08300 (CG010_008620) - 1655451..1656059 (+) 609 WP_099086078.1 DUF922 domain-containing Zn-dependent protease -
  CG010_RS08305 (CG010_008625) - 1656067..1656669 (-) 603 WP_099086077.1 J domain-containing protein -
  CG010_RS08310 (CG010_008630) - 1657065..1657418 (+) 354 WP_003507612.1 nuclear transport factor 2 family protein -

Sequence


Protein


Download         Length: 988 a.a.        Molecular weight: 108611.09 Da        Isoelectric Point: 5.6368

>NTDB_id=330891 CG010_RS08275 WP_099086079.1 1649476..1652442(+) (uvrB) [Agrobacterium tumefaciens strain 186]
MARSPKNSTSSPSGFEEAPQSSFEGAPLSGSVSDWVKQLEAEAEASSVETQREIASKAGKHRKKIEIEARKDAEKAASKT
AKNTTASKTARGVSIGASSDPKTRAAAGLNPVAGMDVSLEDAANLAPGAVTATVDALSKLIESGNPLFKDGKLWTPHRPA
RPPKSEGGVAIRMDSEYQPAGDQPTAINDLVEGINSGERSQVLLGVTGSGKTFTMAKVIEATQRPAVILAPNKTLAAQLY
SEFKNFFPDNAVEYFVSYYDYYQPEAYVPRSDTFIEKESSINEQIDRMRHSATRSLLERDDCIIVASVSCIYGIGSVETY
TAMTFQMQVGDRLDQRQLLADLVAQQYKRRDMDFQRGSFRVRGDTIEIFPAHLEDAAWRISMFGDEIDSITEFDPLTGQK
TGDLQSVKIYANSHYVTPRPTLNGAIKSIKEELKVRLAELEKAGRLLEAQRLEQRTRYDIEMLEATGSCAGIENYSRYLT
GRNPGEPPPTLFEYIPDNALLFIDESHVSVSQIGGMYRGDFRRKATLAEYGFRLPSCMDNRPLRFEEWDAMRPLTVAVSA
TPGSWEMEQAGGVFAEQVIRPTGLIDPPVEVRSARSQVDDVLGEIRETAAKGYRTLCTVLTKRMAEDLTEYLHEQGVRVR
YMHSDIDTLERIEIIRDLRLGAFDVLVGINLLREGLDIPECGFVAILDADKEGFLRSETSLIQTIGRAARNVDGKVILYA
DNITGSMKRAMEETSRRREKQVAYNAEHGITPESVKAKISDILDSVYERDHVRADISGASGKGFADGGHLVGNNLQSHLN
ALEKSMRDAAADLDFEKAARLRDEIKRLKAAELATMDDPMAKEEARAIEGGGKNNRRSHLSISPPEGETSGRTEAGAAPN
ESGKSLFTKPSLDEMGPGSDAGKPLFRRNTLDEMTVGRTEKPVRSAVPDKPETESGKRFSPLMEGQPERTTDDPRPLVRG
KIGAGSYEDAGEQKRKSRTKGKTGRPGR

Nucleotide


Download         Length: 2967 bp        

>NTDB_id=330891 CG010_RS08275 WP_099086079.1 1649476..1652442(+) (uvrB) [Agrobacterium tumefaciens strain 186]
ATGGCCAGATCACCGAAAAACTCCACCTCCTCGCCCTCAGGCTTCGAGGAAGCTCCGCAATCGTCATTCGAAGGCGCGCC
GCTCAGCGGCAGCGTCTCCGATTGGGTGAAGCAGCTCGAGGCGGAAGCGGAGGCATCCTCCGTGGAAACCCAGCGCGAAA
TCGCCTCAAAGGCGGGCAAGCACCGCAAGAAGATCGAGATCGAAGCACGCAAGGACGCGGAGAAGGCCGCCTCGAAGACG
GCCAAGAACACCACGGCCTCCAAGACCGCGCGCGGTGTTTCCATCGGCGCATCGAGCGATCCGAAAACCCGCGCCGCCGC
CGGCCTTAATCCGGTCGCCGGTATGGACGTATCGCTGGAAGACGCCGCCAACCTCGCGCCGGGCGCCGTCACCGCAACGG
TGGACGCGCTGTCGAAGCTGATCGAGAGCGGCAATCCGCTGTTCAAGGACGGCAAGCTCTGGACGCCGCACCGCCCGGCC
CGTCCGCCGAAATCGGAAGGCGGCGTTGCCATCCGCATGGACTCGGAGTACCAGCCCGCCGGCGACCAGCCGACGGCCAT
CAACGACCTCGTGGAAGGCATCAATTCCGGCGAGCGCAGCCAGGTCCTGCTCGGCGTCACCGGCTCCGGCAAGACCTTCA
CCATGGCCAAGGTGATCGAGGCGACGCAGCGCCCGGCCGTCATCCTTGCCCCCAACAAGACGCTGGCCGCGCAGCTCTAT
TCCGAATTCAAGAACTTCTTCCCCGACAATGCGGTAGAGTATTTCGTCTCCTACTACGATTATTACCAGCCGGAAGCCTA
TGTGCCGCGCTCCGACACCTTCATCGAGAAAGAATCCTCGATCAACGAACAGATCGACCGGATGCGCCACTCCGCCACCC
GCTCGCTGCTTGAACGTGACGACTGCATCATCGTCGCCTCCGTCTCCTGCATCTACGGTATCGGCTCGGTCGAAACCTAC
ACCGCCATGACCTTCCAGATGCAGGTGGGCGACCGGCTGGACCAGCGCCAGCTTCTGGCCGACCTCGTGGCCCAGCAATA
CAAGCGCCGCGACATGGATTTCCAGCGCGGTTCGTTCCGCGTGCGCGGCGATACCATCGAAATTTTCCCCGCCCACCTTG
AGGATGCCGCCTGGCGCATCTCGATGTTCGGCGACGAAATCGATTCCATCACCGAATTCGATCCGCTGACCGGCCAGAAA
ACCGGCGACCTGCAATCCGTCAAGATCTACGCCAATTCGCACTATGTCACCCCGCGCCCGACGCTGAACGGCGCGATCAA
GTCGATCAAGGAAGAGCTGAAGGTCCGTCTCGCCGAGCTGGAAAAAGCCGGGCGTCTGCTGGAAGCCCAGCGACTGGAGC
AGCGCACCCGCTACGATATCGAGATGCTGGAGGCGACCGGCTCCTGCGCCGGCATCGAGAACTATTCGCGTTATCTCACC
GGCCGCAACCCCGGCGAGCCGCCGCCGACGCTGTTCGAATATATCCCCGACAACGCGCTGCTGTTCATCGACGAAAGCCA
CGTCTCGGTCAGCCAGATCGGCGGCATGTATCGCGGCGACTTCAGGCGCAAGGCGACGCTGGCCGAATACGGCTTCCGCC
TGCCCTCCTGCATGGACAACCGTCCGCTGCGCTTCGAGGAATGGGATGCCATGCGGCCTCTGACGGTCGCGGTTTCGGCT
ACCCCCGGCTCATGGGAGATGGAACAGGCCGGCGGCGTCTTTGCCGAACAGGTCATCCGCCCGACCGGCCTTATCGATCC
GCCGGTGGAGGTTCGTTCCGCCCGTAGCCAGGTGGACGATGTTCTCGGTGAAATCCGCGAGACAGCCGCCAAAGGCTATC
GCACCCTCTGCACCGTGCTGACGAAACGCATGGCCGAGGACCTGACCGAATATCTGCACGAACAGGGCGTTCGCGTGCGC
TATATGCACTCGGATATCGACACGCTGGAGCGCATCGAGATCATCCGCGACCTGCGTCTCGGCGCTTTCGACGTGCTTGT
TGGTATCAACCTCTTGCGTGAGGGCCTCGACATTCCCGAATGTGGTTTCGTGGCAATCCTCGATGCCGACAAGGAAGGCT
TCCTGCGCTCCGAAACCTCACTGATCCAGACCATCGGCCGCGCCGCCCGTAACGTCGACGGTAAGGTCATTCTTTATGCC
GACAACATCACCGGCTCGATGAAGCGGGCGATGGAGGAAACCTCCCGCCGCCGCGAAAAGCAGGTGGCCTATAACGCCGA
ACACGGCATCACGCCGGAATCGGTCAAGGCGAAGATCTCCGATATTCTTGATTCAGTTTATGAGCGCGATCACGTAAGGG
CAGATATATCAGGCGCTTCCGGCAAGGGCTTCGCCGACGGCGGCCATCTCGTCGGCAACAATCTGCAGTCCCATCTCAAC
GCGCTGGAAAAATCCATGCGCGATGCCGCCGCCGATCTCGACTTCGAAAAGGCCGCCCGCCTGCGCGACGAAATCAAACG
TCTCAAGGCCGCCGAACTCGCCACCATGGACGACCCCATGGCGAAGGAAGAGGCCCGCGCCATCGAAGGCGGTGGAAAAA
ACAACAGGCGCAGCCACTTGTCGATCTCCCCACCTGAGGGGGAGACATCCGGCAGGACGGAGGCGGGCGCCGCGCCGAAC
GAAAGCGGCAAATCCCTTTTCACCAAACCCTCACTGGATGAAATGGGCCCCGGCTCAGATGCGGGAAAACCGCTGTTCCG
CAGGAACACGCTGGACGAGATGACCGTGGGCAGGACCGAAAAGCCCGTGCGCAGCGCAGTACCAGACAAGCCCGAGACCG
AATCCGGCAAACGCTTCTCACCGCTCATGGAAGGCCAGCCGGAGCGTACTACCGATGATCCGCGACCACTGGTGCGCGGC
AAGATCGGCGCGGGGTCCTATGAAGACGCCGGCGAGCAGAAGCGCAAAAGCCGGACGAAGGGCAAGACGGGCCGGCCGGG
GCGCTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  uvrB Streptococcus pneumoniae TIGR4

55.639

67.308

0.374

  uvrB Streptococcus pneumoniae R6

55.639

67.308

0.374

  uvrB Streptococcus pneumoniae D39

55.639

67.308

0.374