Detailed information    

insolico Bioinformatically predicted

Overview


Name   sbcB   Type   Machinery gene
Locus tag   CNQ52_RS09440 Genome accession   NZ_CP023366
Coordinates   1923594..1925021 (-) Length   475 a.a.
NCBI ID   WP_000980581.1    Uniprot ID   -
Organism   Escherichia coli strain 1428     
Function   promote homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1918594..1930021
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  CNQ52_RS09415 (CNQ52_09415) yeeZ 1918649..1919473 (+) 825 WP_000754749.1 SDR family oxidoreductase -
  CNQ52_RS09420 (CNQ52_09420) yeeY 1919519..1920448 (+) 930 WP_000803351.1 LysR substrate-binding domain-containing protein -
  CNQ52_RS27695 yoeI 1920663..1920725 (+) 63 WP_010723108.1 membrane protein YoeI -
  CNQ52_RS09425 (CNQ52_09425) plaP 1920715..1922073 (+) 1359 WP_000019197.1 putrescine/proton symporter PlaP -
  CNQ52_RS09430 (CNQ52_09430) tsuA 1922252..1923310 (+) 1059 WP_023910197.1 thiosulfate utilization transporter TsuA/YeeE -
  CNQ52_RS09435 (CNQ52_09435) tsuB 1923324..1923551 (+) 228 WP_000985273.1 thiosulfate utilization sulfurtransferase TsuB/YeeD -
  CNQ52_RS09440 (CNQ52_09440) sbcB 1923594..1925021 (-) 1428 WP_000980581.1 exodeoxyribonuclease I Machinery gene
  CNQ52_RS09445 (CNQ52_09445) dacD 1925230..1926396 (+) 1167 WP_001563931.1 serine-type D-Ala-D-Ala carboxypeptidase DacD -
  CNQ52_RS09450 (CNQ52_09450) sbmC 1926515..1926988 (+) 474 WP_001105415.1 DNA gyrase inhibitor SbmC -
  CNQ52_RS09455 (CNQ52_09455) yeeA 1927186..1928244 (+) 1059 WP_001200891.1 FUSC family protein -
  CNQ52_RS09460 (CNQ52_09460) tmaR 1928416..1928745 (+) 330 WP_000450409.1 DUF496 family protein -
  CNQ52_RS09465 (CNQ52_09465) - 1928846..1929028 (-) 183 WP_001016348.1 EutP/PduV family microcompartment system protein -
  CNQ52_RS09470 (CNQ52_09470) - 1929100..1929228 (+) 129 Protein_1763 transposase domain-containing protein -
  CNQ52_RS27700 - 1929517..1929597 (-) 81 Protein_1764 hypothetical protein -
  CNQ52_RS09475 (CNQ52_09475) yeeW 1929643..1929837 (-) 195 WP_000988600.1 DUF5983 family protein -

Sequence


Protein


Download         Length: 475 a.a.        Molecular weight: 54484.77 Da        Isoelectric Point: 5.6070

>NTDB_id=206472 CNQ52_RS09440 WP_000980581.1 1923594..1925021(-) (sbcB) [Escherichia coli strain 1428]
MMNDGKQQSTFLFHDYETFGTHPALDRPAQFAAIRTDSEFNVIGEPEVFYCKPADDYLPQPGAVLITGITPQEARAKGEN
EAAFAARIHSLFNVPKTCILGYNNVRFDDEVTRNVFYRNFYDPYAWSWQHDNSRWDLLDVMRACYALRPEGINWPENDDG
LPSFRLEHLTKANGIEHSNAHDAMADVYATIAMAKLVKTRQPRLFDYLFTHRNKHKLMALIDVPQMKPLVHVSGMFGAWR
GNTSWVAPLAWHPENRNAIIMVDLAGDISPLLELDSDTLRERLYTAKTDLGDNAAVPVKLVHINKCPVLAQANTLRPEDA
DRLGINRQHCLDNLKILRENPQVREKVVAIFAEAEPFTPSDNVDAQLYNGFFSDADRAAMKIVLETEPRNLPALDITFVD
KRIEKLLFNYRARNFPGTLDYAEQQRWLEHRRQVFTPEFLQGYADELQMLAQQYADNKEKVALLKALWQYAEEIV

Nucleotide


Download         Length: 1428 bp        

>NTDB_id=206472 CNQ52_RS09440 WP_000980581.1 1923594..1925021(-) (sbcB) [Escherichia coli strain 1428]
ATGATGAATGACGGTAAGCAACAATCTACCTTTTTGTTTCACGATTACGAAACCTTTGGCACGCACCCCGCGTTAGATCG
CCCTGCACAGTTCGCAGCCATTCGCACCGATAGCGAATTCAATGTCATCGGCGAACCCGAAGTCTTTTACTGCAAGCCCG
CGGATGACTATTTGCCCCAGCCTGGAGCAGTATTAATTACCGGTATTACCCCGCAGGAAGCACGGGCGAAAGGAGAAAAC
GAAGCCGCGTTTGCCGCCCGTATTCACTCGCTTTTTAACGTACCGAAGACCTGTATTCTGGGCTACAACAATGTGCGTTT
CGACGACGAAGTCACACGCAACGTTTTTTATCGTAATTTCTACGATCCTTACGCCTGGAGCTGGCAGCATGATAACTCGC
GCTGGGATTTGCTGGATGTTATGCGTGCCTGTTATGCCCTGCGCCCGGAAGGAATAAACTGGCCTGAAAATGATGACGGT
CTACCGAGCTTTCGCCTTGAGCATTTAACCAAAGCGAATGGTATTGAACATAGCAACGCCCACGATGCTATGGCTGATGT
GTACGCCACTATTGCGATGGCAAAGCTGGTAAAAACGCGTCAGCCACGCCTGTTTGATTATCTCTTTACCCATCGCAATA
AACACAAACTGATGGCGTTGATTGATGTTCCGCAGATGAAACCCCTGGTGCACGTTTCCGGAATGTTTGGGGCATGGCGC
GGCAACACCAGCTGGGTGGCACCGCTGGCGTGGCATCCTGAAAATCGCAATGCCATAATTATGGTGGATTTGGCAGGAGA
CATTTCGCCATTACTGGAACTGGATAGCGACACATTGCGCGAGCGTTTATATACCGCAAAAACCGATCTTGGCGATAACG
CCGCCGTTCCGGTTAAGCTGGTGCACATCAATAAATGTCCGGTGCTGGCCCAGGCGAATACGCTACGCCCGGAAGATGCC
GACCGACTGGGAATTAATCGTCAGCATTGCCTCGATAACCTGAAAATTCTGCGTGAAAATCCGCAAGTGCGTGAAAAAGT
GGTGGCGATATTCGCGGAAGCCGAACCGTTTACGCCTTCAGATAACGTGGATGCACAGCTTTATAACGGCTTTTTCAGTG
ACGCCGATCGCGCAGCAATGAAAATTGTGCTGGAAACCGAGCCGCGTAATTTACCGGCACTGGATATCACTTTTGTTGAT
AAACGAATTGAAAAACTGTTGTTCAATTATCGGGCACGCAACTTCCCGGGGACGCTGGATTATGCCGAGCAGCAACGCTG
GCTGGAGCACCGCCGCCAGGTCTTCACGCCCGAGTTTTTACAAGGTTATGCAGATGAATTGCAGATGCTGGCACAACAAT
ATGCCGATAACAAAGAGAAAGTGGCGCTGTTAAAAGCGCTTTGGCAGTACGCGGAAGAGATCGTCTAA

Domains


Predicted by InterProScan.

(13-188)

(212-472)


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  sbcB Vibrio cholerae O1 biovar El Tor strain E7946

58.511

98.947

0.579


Multiple sequence alignment