Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB/pilB1   Type   Machinery gene
Locus tag   MW398_RS10025 Genome accession   NZ_CP095505
Coordinates   1823090..1824583 (-) Length   497 a.a.
NCBI ID   WP_021524514.1    Uniprot ID   -
Organism   Escherichia coli strain GN02050     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1818090..1829583
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  MW398_RS09995 (MW398_09985) gspK 1818884..1819861 (-) 978 WP_021538155.1 type II secretion system minor pseudopilin GspK -
  MW398_RS10000 (MW398_09990) gspJ 1819858..1820463 (-) 606 WP_001331694.1 type II secretion system minor pseudopilin GspJ -
  MW398_RS10005 (MW398_09995) gspI 1820460..1820831 (-) 372 WP_000820096.1 type II secretion system minor pseudopilin GspI -
  MW398_RS10010 (MW398_10000) gspH 1820828..1821391 (-) 564 WP_001115118.1 type II secretion system minor pseudopilin GspH -
  MW398_RS10015 (MW398_10005) gspG 1821395..1821850 (-) 456 WP_001087289.1 type II secretion system major pseudopilin GspG -
  MW398_RS10020 (MW398_10010) gspF 1821867..1823090 (-) 1224 WP_001173408.1 type II secretion system inner membrane protein GspF -
  MW398_RS10025 (MW398_10015) pilB/pilB1 1823090..1824583 (-) 1494 WP_021524514.1 type II secretion system ATPase GspE Machinery gene
  MW398_RS10030 (MW398_10020) gspD 1824583..1826643 (-) 2061 WP_000498844.1 type II secretion system secretin GspD -
  MW398_RS10035 (MW398_10025) gspC 1826673..1827632 (-) 960 WP_000135098.1 type II secretion system protein GspC -
  MW398_RS10040 (MW398_10030) gspS2 1827650..1828060 (-) 411 WP_001298257.1 type II secretion system pilot lipoprotein GspS-beta -
  MW398_RS10045 (MW398_10035) pilD 1828126..1828935 (-) 810 WP_000895858.1 prepilin peptidase PppA Machinery gene

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 55129.21 Da        Isoelectric Point: 5.8815

>NTDB_id=583235 MW398_RS10025 WP_021524514.1 1823090..1824583(-) (pilB/pilB1) [Escherichia coli strain GN02050]
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNAPFTLRQIDEAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSLELT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCSDCRQAAPA
TDEEKRLMGISDTHAVTLYHSQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=583235 MW398_RS10025 WP_021524514.1 1823090..1824583(-) (pilB/pilB1) [Escherichia coli strain GN02050]
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTTCATCCGTTGTCGCTCTCTGTTTTACAGGAGCTACAGCGGGGGCTGA
ATGCGCCCTTTACACTGCGGCAAATCGACGAGGCTGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAAGCTCGCCAGCTGATGGAAGATCTCGGTTCCGCCGAGGACTTTTTTACCCTCGCTGAAGAACTGCCGGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCAATCAAAGAAGGCGCTT
CGGATATCCACATTGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGTGTTGACGGCACATTACATGAAATGTTGCGC
CCCGGTCGTAAACTGGCCTCGCTGCTGGTCTCGCGTATCAAGGTGATGGCGCGACTGGATATTGCCGAAAAGCGCGTACC
GCAGGATGGCCGTATTGCGTTGCTGCTGGGCGGTCGGGCGATTGACGTCCGTGTATCTACCATGCCTTCCGCCTGGGGAG
AACGGGTGGTGCTGCGACTGCTGGACAAAAACCAGGCTCGCCTGACGCTGGAGCGTCTGGGTTTAAGTCTCGAACTGACT
GCGCAGTTGCGCCAGCTGTTACACAAACCGCACGGCATTTTTCTGGTGACGGGGCCGACCGGTTCCGGCAAAAGCACCAC
GCTGTACGCTGGATTGCAGGAGCTGAACAACCACTCGCGTAACATTCTCACGGTTGAAGACCCTATCGAATACATGATTG
AAGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACATTCGCCCGTGGCCTGCGCGCAATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATCCGCGATACCGAAACCGCAGAAATCGCTGTTCAGGCTTCACTGACCGGACACCT
GGTACTTTCCACGCTGCATACCAACACAGCGGTGGGGGCGATCACACGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGCGTGATGGCGCAGCGACTGGTCCGCACGCTGTGCTCCGACTGCCGTCAGGCCGCGCCTGCC
ACCGACGAAGAAAAACGTCTTATGGGGATCTCCGATACGCATGCCGTCACGCTGTACCATTCGCAGGGCTGCCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGTACTGCCATCCATGAACTGATTGTGGTGGACGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAACTGGAGCTGGAACGTTATGTCCGGCAACACTCTGCGGGTATCCGCAGTAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB/pilB1 Synechocystis sp. PCC 6803

39.926

100

0.435

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

47.529

85.513

0.406

  pilB Vibrio parahaemolyticus RIMD 2210633

47.859

79.879

0.382

  pilB Acinetobacter baumannii D1279779

46.617

80.282

0.374

  pilB Vibrio campbellii strain DS40M4

46.97

79.678

0.374

  pilB Legionella pneumophila strain ERS1305867

43.155

86.72

0.374

  pilB Vibrio cholerae strain A1552

46.212

79.678

0.368

  pilF Thermus thermophilus HB27

44.75

80.483

0.36