Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB/pilB1   Type   Machinery gene
Locus tag   NL424_RS11320 Genome accession   NZ_CP117020
Coordinates   2261372..2262865 (-) Length   497 a.a.
NCBI ID   WP_049067526.1    Uniprot ID   -
Organism   Escherichia coli strain MLI106K3     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 2256372..2267865
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  NL424_RS11290 (NL424_011285) gspK 2257166..2258143 (-) 978 WP_000633199.1 type II secretion system minor pseudopilin GspK -
  NL424_RS11295 (NL424_011290) gspJ 2258140..2258745 (-) 606 WP_024198763.1 type II secretion system minor pseudopilin GspJ -
  NL424_RS11300 (NL424_011295) gspI 2258742..2259113 (-) 372 WP_000820112.1 type II secretion system minor pseudopilin GspI -
  NL424_RS11305 (NL424_011300) gspH 2259110..2259673 (-) 564 WP_021513238.1 type II secretion system minor pseudopilin GspH -
  NL424_RS11310 (NL424_011305) gspG 2259677..2260132 (-) 456 WP_001087296.1 type II secretion system major pseudopilin GspG -
  NL424_RS11315 (NL424_011310) gspF 2260149..2261372 (-) 1224 WP_049067524.1 type II secretion system inner membrane protein GspF -
  NL424_RS11320 (NL424_011315) pilB/pilB1 2261372..2262865 (-) 1494 WP_049067526.1 type II secretion system ATPase GspE Machinery gene
  NL424_RS11325 (NL424_011320) gspD 2262865..2264925 (-) 2061 WP_000498830.1 type II secretion system secretin GspD -
  NL424_RS11330 (NL424_011325) gspC 2264955..2265914 (-) 960 WP_001366858.1 type II secretion system protein GspC -
  NL424_RS11335 (NL424_011330) gspS2 2265932..2266342 (-) 411 WP_001309757.1 type II secretion system pilot lipoprotein GspS-beta -
  NL424_RS11340 (NL424_011335) pilD 2266408..2267217 (-) 810 WP_001596192.1 prepilin peptidase PppA Machinery gene

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 55190.29 Da        Isoelectric Point: 6.0089

>NTDB_id=716250 NL424_RS11320 WP_049067526.1 2261372..2262865(-) (pilB/pilB1) [Escherichia coli strain MLI106K3]
MVPVAQETSANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNASFTLRQIDEAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSHELT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQPAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=716250 NL424_RS11320 WP_049067526.1 2261372..2262865(-) (pilB/pilB1) [Escherichia coli strain MLI106K3]
ATGGTGCCTGTAGCACAGGAAACCTCCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTTCATCCGTTGTCGCTCTCTGTTTTGCAGGAGCTGCAGCGGGGGCTGA
ACGCGTCTTTTACGCTGAGGCAAATCGACGAGGCCGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAGGCCCGCCAGTTGATGGAAGATCTCGGTTCTGCCGAGGACTTTTTTACCCTCGCAGAAGAACTGCCGGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCGATTAAAGAAGGCGCTT
CGGATATCCACATCGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGCGTTGACGGCACATTACATGAAATGCTGCGT
CCGGGGCGCAAACTGGCCTCGCTGCTGGTATCGCGTATTAAGGTGATGGCACGGCTGGATATCGCCGAAAAGCGCGTACC
GCAGGATGGCCGTATTGCGCTGCTGCTGGGCGGTCGGGCGATTGACGTGCGCGTCTCCACCATGCCTTCTGCCTGGGGCG
AGCGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCCCGCCTGACGCTGGAGCGTCTGGGTTTAAGTCACGAACTGACC
GCGCAGTTGCGCCAGCTACTGCACAAACCGCACGGCATCTTTCTGGTGACGGGACCGACGGGTTCCGGCAAAAGCACCAC
GCTGTACGCCGGATTGCAGGAGCTGAACAACCATTCGCGCAACATTCTCACGGTTGAAGACCCCATCGAATACATGATTG
AAGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACCTTCGCCCGTGGCCTGCGCGCGATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATCCGCGATACCGAAACCGCAGAAATCGCCGTTCAGGCGTCGCTCACGGGGCACCT
GGTACTTTCCACACTGCATACCAACACGGCGGTGGGGGCGATTACGCGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGTGTGATGGCGCAGCGACTGGTCCGCACGCTGTGCCCCGACTGCCGCCAGCCCGCACCTGCC
ACTGACGAAGAAAAACGCCTGCTGGGAATTACCGACGCGCGTACCGTCACTCTGTACCATCCACAGGGCTGCCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGTACTGCCATCCATGAGTTGATCGTGGTGGACGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAGCTGGAGCTGGAACGTTATGTCCGACAACACTCTGCGGGTATCCGCAGCAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB/pilB1 Synechocystis sp. PCC 6803

39.556

100

0.431

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

47.765

85.513

0.408

  pilB Legionella pneumophila strain ERS1305867

42.398

93.964

0.398

  pilB Vibrio parahaemolyticus RIMD 2210633

48.363

79.879

0.386

  pilB Vibrio campbellii strain DS40M4

47.475

79.678

0.378

  pilB Acinetobacter baumannii D1279779

46.617

80.282

0.374

  pilB Vibrio cholerae strain A1552

45.96

79.678

0.366

  pilF Thermus thermophilus HB27

45

80.483

0.362