Detailed information    

insolico Bioinformatically predicted

Overview


Name   sbcB   Type   Machinery gene
Locus tag   AM333_RS21000 Genome accession   NZ_CP024851
Coordinates   4036114..4037541 (+) Length   475 a.a.
NCBI ID   WP_021523141.1    Uniprot ID   -
Organism   Escherichia coli strain AR_0006     
Function   promote homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4031114..4042541
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  AM333_RS20965 (AM333_20980) yeeW 4031298..4031492 (+) 195 WP_000988600.1 DUF5983 family protein -
  AM333_RS28165 - 4031538..4031618 (+) 81 Protein_3818 hypothetical protein -
  AM333_RS28985 (AM333_20990) - 4032107..4032289 (+) 183 WP_001016348.1 EutP/PduV family microcompartment system protein -
  AM333_RS20980 (AM333_20995) tmaR 4032390..4032719 (-) 330 WP_000450409.1 DUF496 family protein -
  AM333_RS20985 (AM333_21000) yeeA 4032891..4033949 (-) 1059 WP_001200890.1 FUSC family protein -
  AM333_RS20990 (AM333_21005) sbmC 4034147..4034620 (-) 474 WP_001105416.1 DNA gyrase inhibitor SbmC -
  AM333_RS20995 (AM333_21010) dacD 4034739..4035905 (-) 1167 WP_021523140.1 serine-type D-Ala-D-Ala carboxypeptidase DacD -
  AM333_RS21000 (AM333_21015) sbcB 4036114..4037541 (+) 1428 WP_021523141.1 exodeoxyribonuclease I Machinery gene
  AM333_RS21005 (AM333_21020) tsuB 4037584..4037811 (-) 228 WP_000985273.1 thiosulfate utilization sulfurtransferase TsuB/YeeD -
  AM333_RS21010 (AM333_21025) tsuA 4037825..4038883 (-) 1059 WP_000492324.1 thiosulfate utilization transporter TsuA/YeeE -
  AM333_RS21015 (AM333_21030) plaP 4039062..4040420 (-) 1359 WP_000019197.1 putrescine/proton symporter PlaP -
  AM333_RS21020 yoeI 4040410..4040472 (-) 63 WP_010723108.1 membrane protein YoeI -
  AM333_RS21025 (AM333_21035) yeeY 4040687..4041616 (-) 930 WP_023154044.1 LysR substrate-binding domain-containing protein -
  AM333_RS21030 (AM333_21040) yeeZ 4041662..4042486 (-) 825 WP_000754758.1 SDR family oxidoreductase -

Sequence


Protein


Download         Length: 475 a.a.        Molecular weight: 54513.81 Da        Isoelectric Point: 5.4700

>NTDB_id=214738 AM333_RS21000 WP_021523141.1 4036114..4037541(+) (sbcB) [Escherichia coli strain AR_0006]
MMNDGKQQSTFLFHDYETFGTHPALDRPAQFAAIRTDNEFNVIGEPEVFYCKPADDYLPQPGAVLITGITPQEARAKGEN
EATFAARIHSLFTVPKTCILGYNNVRFDDEVTRNVFYRNFYDPYAWSWQHDNSRWDLLDVMRACYALRPEGINWPENDDG
LPSFRLEHLTKANGIEHSNAHDAMADVYATIAMAKLVKTRQPRLFDYLFTHRNKHKLMALIDVPQMKPLVHVSGMFGAWR
GNTSWVAPLAWHPENRNVVIMVDLAGDISPLLELDSDTLRERLYTAKADLGDNAAVPVKLVHINKCPVLAQANTLRPEDA
DRLGINRQHCLDNLKILRENPQVREKVVAIFAEAEPFTPSDNVDAQLYNGFFSDADRAAMKIVLETEPRNLPALDITFVD
KRIEKLLFNYRARNFPGTLDYAEQQRWLEHRRQVFTPEFLQGYADELQMLAQQYADDKEKVALLKALWQYAEEIV

Nucleotide


Download         Length: 1428 bp        

>NTDB_id=214738 AM333_RS21000 WP_021523141.1 4036114..4037541(+) (sbcB) [Escherichia coli strain AR_0006]
ATGATGAATGACGGTAAGCAACAATCTACCTTTTTGTTTCACGATTACGAAACCTTTGGAACGCACCCCGCGTTAGATCG
CCCTGCACAGTTCGCAGCCATTCGCACTGATAACGAATTCAATGTAATCGGCGAACCCGAAGTCTTTTACTGCAAGCCCG
CGGATGACTATTTACCCCAGCCTGGAGCAGTATTAATTACCGGTATTACCCCGCAGGAAGCACGGGCGAAAGGAGAAAAC
GAAGCCACGTTTGCCGCCCGTATTCACTCGCTTTTTACCGTACCGAAGACCTGTATTCTGGGCTACAACAATGTGCGTTT
CGACGACGAAGTCACACGCAACGTTTTTTATCGTAATTTCTACGATCCTTACGCCTGGAGCTGGCAGCATGATAACTCGC
GCTGGGATTTACTGGATGTTATGCGTGCCTGTTATGCCCTGCGCCCGGAAGGAATAAACTGGCCTGAAAATGATGACGGT
CTACCGAGCTTTCGCCTTGAGCATTTAACCAAAGCGAATGGTATTGAACATAGCAACGCCCACGATGCGATGGCTGATGT
GTACGCCACTATTGCGATGGCGAAACTGGTAAAAACGCGTCAGCCACGTCTGTTTGATTATCTCTTTACCCATCGTAATA
AACACAAACTGATGGCGTTGATTGATGTTCCGCAGATGAAACCCCTGGTTCACGTTTCCGGAATGTTTGGGGCATGGCGT
GGCAATACCAGCTGGGTGGCACCGCTGGCGTGGCATCCTGAAAATCGCAATGTCGTAATTATGGTGGATTTGGCAGGAGA
CATTTCGCCATTACTGGAGCTGGATAGCGACACATTGCGCGAGCGTTTATATACCGCAAAAGCCGATCTTGGCGATAACG
CCGCCGTTCCGGTTAAGCTGGTGCACATCAATAAATGTCCGGTACTGGCCCAGGCGAATACGCTACGCCCGGAAGATGCC
GACCGACTGGGAATTAATCGTCAGCATTGCCTCGATAACCTAAAAATTCTGCGTGAAAATCCGCAAGTGCGTGAAAAAGT
GGTGGCGATATTCGCGGAAGCCGAACCGTTTACGCCTTCAGATAACGTGGATGCACAGCTTTATAACGGCTTTTTCAGTG
ACGCCGATCGTGCAGCAATGAAAATTGTGCTGGAAACCGAGCCGCGTAATTTACCGGCACTGGATATCACTTTTGTTGAT
AAACGAATTGAAAAACTGTTGTTCAATTATCGGGCGCGCAACTTCCCGGGGACGCTGGATTATGCCGAGCAGCAACGCTG
GCTTGAGCACCGCCGCCAGGTCTTCACGCCAGAGTTTTTGCAGGGCTACGCTGATGAATTGCAGATGCTGGCACAACAGT
ATGCCGATGACAAAGAGAAAGTGGCGCTGTTAAAAGCGCTTTGGCAGTACGCGGAAGAGATCGTCTAA

Domains


Predicted by InterProScan.

(212-472)

(13-188)


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  sbcB Vibrio cholerae O1 biovar El Tor strain E7946

58.723

98.947

0.581


Multiple sequence alignment