Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB/pilB1   Type   Machinery gene
Locus tag   V6S34_RS20345 Genome accession   NZ_CP145671
Coordinates   4129992..4131485 (+) Length   497 a.a.
NCBI ID   WP_000249328.1    Uniprot ID   -
Organism   Escherichia coli strain S1-ZIM-01-A     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4124992..4136485
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S34_RS20325 (V6S34_20325) pilD 4125640..4126449 (+) 810 WP_273683860.1 prepilin peptidase PppA Machinery gene
  V6S34_RS20330 (V6S34_20330) gspS2 4126515..4126925 (+) 411 WP_001300497.1 type II secretion system pilot lipoprotein GspS-beta -
  V6S34_RS20335 (V6S34_20335) gspC 4126943..4127902 (+) 960 WP_000135079.1 type II secretion system protein GspC -
  V6S34_RS20340 (V6S34_20340) gspD 4127932..4129992 (+) 2061 WP_001547019.1 type II secretion system secretin GspD -
  V6S34_RS20345 (V6S34_20345) pilB/pilB1 4129992..4131485 (+) 1494 WP_000249328.1 type II secretion system ATPase GspE Machinery gene
  V6S34_RS20350 (V6S34_20350) gspF 4131485..4132708 (+) 1224 WP_001173413.1 type II secretion system inner membrane protein GspF -
  V6S34_RS20355 (V6S34_20355) gspG 4132725..4133180 (+) 456 WP_001087289.1 type II secretion system major pseudopilin GspG -
  V6S34_RS20360 (V6S34_20360) gspH 4133184..4133747 (+) 564 WP_001115122.1 type II secretion system minor pseudopilin GspH -
  V6S34_RS20365 (V6S34_20365) gspI 4133744..4134115 (+) 372 WP_000820077.1 type II secretion system minor pseudopilin GspI -
  V6S34_RS20370 (V6S34_20370) gspJ 4134112..4134717 (+) 606 WP_273683861.1 type II secretion system minor pseudopilin GspJ -
  V6S34_RS20375 (V6S34_20375) gspK 4134714..4135682 (+) 969 WP_000633246.1 type II secretion system minor pseudopilin GspK -

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 55190.29 Da        Isoelectric Point: 6.0084

>NTDB_id=852044 V6S34_RS20345 WP_000249328.1 4129992..4131485(+) (pilB/pilB1) [Escherichia coli strain S1-ZIM-01-A]
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNAPFTLRQIDEAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSHELT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIDGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQSAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=852044 V6S34_RS20345 WP_000249328.1 4129992..4131485(+) (pilB/pilB1) [Escherichia coli strain S1-ZIM-01-A]
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTTCATCCGTTGTCGCTCTCTGTTTTACAGGAGCTACAGCGGGGGCTGA
ATGCGCCCTTTACACTGCGGCAAATCGACGAGGCTGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAAGCTCGCCAGCTGATGGAAGATCTCGGTTCCGCCGAGGACTTTTTTACCCTCGCTGAAGAACTGCCGGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCAATCAAAGAAGGCGCTT
CGGATATCCACATTGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGTGTTGACGGCACATTACATGAAATGTTGCGC
CCCGGTCGTAAACTGGCCTCGCTGCTGGTCTCGCGTATCAAGGTGATGGCGCGACTGGATATCGCCGAAAAGCGCGTACC
GCAGGATGGCCGTATTGCGCTGCTGCTGGGCGGTCGGGCGATTGACGTCCGTGTATCTACCATGCCTTCTGCCTGGGGGG
AACGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCTCGCCTGACGCTGGAGCGTCTTGGTTTGAGTCACGAACTGACT
GCGCAGTTGCGCCAGCTGTTACACAAACCGCACGGCATTTTTCTGGTGACGGGGCCGACCGGTTCCGGCAAAAGCACCAC
GCTGTACGCTGGATTGCAGGAGCTGAACAACCACTCGCGTAACATTCTCACGGTTGAAGACCCTATCGAATACATGATTG
ACGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACATTCGCCCGTGGCCTGCGCGCAATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATCCGCGATACCGAAACCGCAGAAATCGCTGTTCAGGCTTCACTGACCGGACACCT
GGTACTTTCCACGCTGCATACCAACACAGCGGTGGGGGCGATCACGCGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGCGTGATGGCGCAGCGACTGGTTCGCACGCTGTGTCCCGATTGCCGCCAGTCCGCGCCTGCC
ACCGACGAAGAAAAACGCCTGCTGGGAATTACCGATGCGCGAACCGTCACGCTGTACCATCCGCAGGGCTGCCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGTACTGCCATCCATGAGCTGATCGTGGTAGACGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAACTGGAGCTGGAACGTTATGTCCGGCAACACTCTGCGGGTATCCGCAGTAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB/pilB1 Synechocystis sp. PCC 6803

39.556

100

0.431

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

47.529

85.513

0.406

  pilB Vibrio parahaemolyticus RIMD 2210633

48.111

79.879

0.384

  pilB Legionella pneumophila strain ERS1305867

43.619

86.72

0.378

  pilB Vibrio campbellii strain DS40M4

47.222

79.678

0.376

  pilB Acinetobacter baumannii D1279779

46.115

80.282

0.37

  pilB Vibrio cholerae strain A1552

45.96

79.678

0.366

  pilB Acinetobacter baylyi ADP1

46.154

78.471

0.362

  pilF Thermus thermophilus HB27

45

80.483

0.362