Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB/pilB1   Type   Machinery gene
Locus tag   E2126_RS23850 Genome accession   NZ_CP054388
Coordinates   5031908..5033401 (+) Length   497 a.a.
NCBI ID   WP_000249373.1    Uniprot ID   -
Organism   Escherichia coli strain 1517k     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 5026908..5038401
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  E2126_RS23830 (E2126_023820) pilD 5027556..5028365 (+) 810 WP_001361237.1 prepilin peptidase PppA Machinery gene
  E2126_RS23835 (E2126_023825) gspS2 5028431..5028841 (+) 411 WP_001361238.1 type II secretion system pilot lipoprotein GspS-beta -
  E2126_RS23840 (E2126_023830) gspC 5028859..5029818 (+) 960 WP_000135084.1 type II secretion system protein GspC -
  E2126_RS23845 (E2126_023835) gspD 5029848..5031908 (+) 2061 WP_000498848.1 type II secretion system secretin GspD -
  E2126_RS23850 (E2126_023840) pilB/pilB1 5031908..5033401 (+) 1494 WP_000249373.1 type II secretion system ATPase GspE Machinery gene
  E2126_RS23855 (E2126_023845) gspF 5033401..5034624 (+) 1224 WP_001173427.1 type II secretion system inner membrane protein GspF -
  E2126_RS23860 (E2126_023850) gspG 5034641..5035096 (+) 456 WP_001087296.1 type II secretion system major pseudopilin GspG -
  E2126_RS23865 (E2126_023855) gspH 5035100..5035663 (+) 564 WP_001115117.1 type II secretion system minor pseudopilin GspH -
  E2126_RS23870 (E2126_023860) gspI 5035660..5036031 (+) 372 WP_000820092.1 type II secretion system minor pseudopilin GspI -
  E2126_RS23875 (E2126_023865) gspJ 5036028..5036633 (+) 606 WP_001254778.1 type II secretion system minor pseudopilin GspJ -
  E2126_RS23880 (E2126_023870) gspK 5036630..5037607 (+) 978 WP_000633197.1 type II secretion system minor pseudopilin GspK -

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 55194.27 Da        Isoelectric Point: 6.0089

>NTDB_id=399334 E2126_RS23850 WP_000249373.1 5031908..5033401(+) (pilB/pilB1) [Escherichia coli strain 1517k]
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNASFTLRQIDEAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSHELT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQSAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=399334 E2126_RS23850 WP_000249373.1 5031908..5033401(+) (pilB/pilB1) [Escherichia coli strain 1517k]
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTTCATCCGTTGTCGCTCTCTGTTTTGCAGGAGCTGCAGCGGGGGCTGA
ACGCGTCTTTTACGCTGAGGCAAATCGACGAGGCCGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAGGCCCGCCAGCTGATGGAAGATCTCGGTTCTGCTGAGGACTTTTTTACTCTCGCAGAAGAACTACCGGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCAATCATCAAACTGATCAACGCCATGTTGGCAGAGGCGATTAAAGAAGGCGCTT
CGGATATCCACATCGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGTGTTGACGGCACACTACATGAAATGCTGCGT
CCGGGGCGCAAACTGGCCTCGCTGCTGGTATCGCGTATTAAGGTGATGGCACGGCTGGATATCGCCGAAAAACGCGTACC
GCAGGATGGGCGCATTGCGCTGCTGCTGGGCGGTCGGGCGATTGACGTGCGTGTCTCCACCATGCCCTCCGCCTGGGGCG
AGCGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCCCGCCTGACGCTGGAACGTCTGGGGTTGAGTCACGAACTGACC
GCGCAGTTGCGCCAGCTGTTACACAAACCGCACGGCATTTTTCTGGTGACGGGGCCGACCGGTTCCGGCAAAAGCACCAC
GCTGTACGCTGGATTGCAGGAGCTGAACAACCACTCGCGTAACATTCTCACGGTTGAAGACCCTATCGAATACATGATTG
AAGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACCTTCGCCCGTGGCCTGCGCGCGATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATCCGCGATACCGAAACCGCAGAAATCGCTGTTCAGGCTTCACTGACCGGACACCT
GGTACTTTCCACGCTGCATACCAACACGGCGGTGGGGGCGATCACGCGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGCGTGATGGCGCAGCGACTGGTTCGCACGCTGTGTCCCGATTGCCGCCAGTCCGCGCCTGCC
ACCGACGAAGAAAAACGCCTGCTGGGGATTACCGATGCGCGAACCGTCACGCTGTACCATCCGCAGGGCTGTCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGTACTGCCATCCATGAGCTGATCGTGGTGGACGCCACATTACGTGATTTGATCCACC
GTCAGGCCGGGGAACTGGAGCTGGAACGTTATGTCCGGCAACACTCTGCGGGTATCCGCAGCAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB/pilB1 Synechocystis sp. PCC 6803

39.556

100

0.431

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

47.529

85.513

0.406

  pilB Legionella pneumophila strain ERS1305867

42.398

93.964

0.398

  pilB Vibrio parahaemolyticus RIMD 2210633

48.111

79.879

0.384

  pilB Vibrio campbellii strain DS40M4

47.222

79.678

0.376

  pilB Acinetobacter baumannii D1279779

46.366

80.282

0.372

  pilB Vibrio cholerae strain A1552

45.96

79.678

0.366

  pilB Acinetobacter baylyi ADP1

46.41

78.471

0.364

  pilF Thermus thermophilus HB27

45

80.483

0.362