Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB/pilB1   Type   Machinery gene
Locus tag   H0272_RS23525 Genome accession   NZ_CP059281
Coordinates   4874074..4875567 (-) Length   497 a.a.
NCBI ID   WP_001598631.1    Uniprot ID   -
Organism   Escherichia coli strain C9     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4869074..4880567
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  H0272_RS23495 (H0272_23495) gspK 4869868..4870845 (-) 978 WP_000633195.1 type II secretion system minor pseudopilin GspK -
  H0272_RS23500 (H0272_23500) gspJ 4870842..4871447 (-) 606 WP_032152728.1 type II secretion system minor pseudopilin GspJ -
  H0272_RS23505 (H0272_23505) gspI 4871444..4871815 (-) 372 WP_000820090.1 type II secretion system minor pseudopilin GspI -
  H0272_RS23510 (H0272_23510) gspH 4871812..4872375 (-) 564 WP_032152729.1 type II secretion system minor pseudopilin GspH -
  H0272_RS23515 (H0272_23515) gspG 4872379..4872834 (-) 456 WP_001087289.1 type II secretion system major pseudopilin GspG -
  H0272_RS23520 (H0272_23520) gspF 4872851..4874074 (-) 1224 WP_032152730.1 type II secretion system inner membrane protein GspF -
  H0272_RS23525 (H0272_23525) pilB/pilB1 4874074..4875567 (-) 1494 WP_001598631.1 type II secretion system ATPase GspE Machinery gene
  H0272_RS23530 (H0272_23530) gspD 4875567..4877627 (-) 2061 WP_000498829.1 type II secretion system secretin GspD -
  H0272_RS23535 (H0272_23535) gspC 4877657..4878616 (-) 960 WP_103818134.1 type II secretion system protein GspC -
  H0272_RS23540 (H0272_23540) gspS2 4878634..4879044 (-) 411 WP_001300497.1 type II secretion system pilot lipoprotein GspS-beta -
  H0272_RS23545 (H0272_23545) pilD 4879110..4879919 (-) 810 WP_001547020.1 prepilin peptidase PppA Machinery gene

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 55204.31 Da        Isoelectric Point: 6.0089

>NTDB_id=409431 H0272_RS23525 WP_001598631.1 4874074..4875567(-) (pilB/pilB1) [Escherichia coli strain C9]
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNAPFTLRQIDEAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSHELT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQSAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=409431 H0272_RS23525 WP_001598631.1 4874074..4875567(-) (pilB/pilB1) [Escherichia coli strain C9]
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTGCATCCGTTGTCGCTCTCTGTTTTGCAGGAGCTGCAACGGGGGCTGA
ACGCGCCCTTTACGCTGCGGCAAATCGACGAGGCCGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCCTCC
GAGGCTCGCCAGCTGATGGAAGATCTCGGTTCCGCCGAGGACTTTTTTACCCTCGCTGAAGAACTGCCGGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCGATTAAAGAAGGCGCTT
CGGATATCCACATCGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGCGTTGACGGCACATTACATGAAATGCTGCGT
CCGGGGCGCAAACTGGCCTCGCTGCTGGTATCGCGTATTAAGGTGATGGCACGGCTGGATATCGCCGAAAAGCGCGTACC
GCAGGATGGTCGTATTGCGCTGCTGCTGGGCGGTCGGGCGATCGACGTGCGTGTCTCCACCATGCCATCCGCCTGGGGCG
AGCGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCCCGCCTGACGCTGGAGCGTCTGGGTTTAAGTCACGAACTGACC
GCGCAGTTGCGCCAGCTACTGCACAAACCGCACGGCATCTTTCTGGTGACGGGGCCGACGGGTTCCGGCAAAAGCACCAC
GCTGTACGCCGGATTGCAGGAGCTGAACAACCATTCGCGTAACATTCTCACGGTTGAAGACCCCATCGAATACATGATTG
AAGGGATCGGTCAGACACAGGTTAACACCCGCGTCGGCATGACCTTTGCCCGTGGCCTGCGCGCGATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATCCGCGATACCGAAACCGCAGAAATCGCCGTTCAGGCGTCGCTCACTGGGCACCT
GGTACTTTCCACACTGCATACCAACACGGCGGTGGGGGCGATCACGCGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTTTGACGGGCGTGATGGCGCAGCGACTGGTTCGCACGCTGTGTCCCGATTGCCGCCAGTCCGCGCCTGCC
ACTGACGAAGAAAAACGCCTGCTGGGGATTACCGATGCGCGTACCGTCACGCTGTACCATCCGCAGGGCTGCCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGTACCGCTATCCATGAACTGATTGTGGTGGACGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAACTGGAGCTGGAACGTTATGTCCGGCAACACTCTGCGGGTATCCGCAGCAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB/pilB1 Synechocystis sp. PCC 6803

39.556

100

0.431

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

47.529

85.513

0.406

  pilB Vibrio parahaemolyticus RIMD 2210633

48.111

79.879

0.384

  pilB Legionella pneumophila strain ERS1305867

43.619

86.72

0.378

  pilB Vibrio campbellii strain DS40M4

47.222

79.678

0.376

  pilB Acinetobacter baumannii D1279779

46.366

80.282

0.372

  pilB Vibrio cholerae strain A1552

45.96

79.678

0.366

  pilB Acinetobacter baylyi ADP1

46.41

78.471

0.364

  pilF Thermus thermophilus HB27

45

80.483

0.362


Multiple sequence alignment