Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   V6S45_RS19415 Genome accession   NZ_CP145630
Coordinates   4020196..4021677 (+) Length   493 a.a.
NCBI ID   WP_001219899.1    Uniprot ID   -
Organism   Escherichia coli strain S1-SRL-01-C     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4015196..4026677
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S45_RS19395 (V6S45_19395) gspB 4015365..4015784 (-) 420 WP_000461440.1 putative general secretion pathway protein GspB -
  V6S45_RS19400 (V6S45_19400) gspA 4015786..4017255 (-) 1470 WP_000107582.1 type II secretion system protein GspA -
  V6S45_RS19405 (V6S45_19405) gspC 4017435..4018250 (+) 816 WP_001469472.1 type II secretion system protein GspC -
  V6S45_RS19410 (V6S45_19410) gspD 4018234..4020186 (+) 1953 WP_001604902.1 type II secretion system secretin GspD -
  V6S45_RS19415 (V6S45_19415) pilB 4020196..4021677 (+) 1482 WP_001219899.1 type II secretion system ATPase GspE Machinery gene
  V6S45_RS19420 (V6S45_19420) gspF 4021674..4022870 (+) 1197 WP_001109559.1 type II secretion system inner membrane protein GspF -
  V6S45_RS19425 (V6S45_19425) gspG 4022880..4023317 (+) 438 WP_001202877.1 type II secretion system major pseudopilin GspG -
  V6S45_RS19430 (V6S45_19430) gspH 4023325..4023834 (+) 510 WP_001076042.1 type II secretion system minor pseudopilin GspH -
  V6S45_RS19435 (V6S45_19435) gspI 4023831..4024208 (+) 378 WP_001041753.1 type II secretion system minor pseudopilin GspI -
  V6S45_RS19440 (V6S45_19440) gspJ 4024201..4024788 (+) 588 WP_000610627.1 type II secretion system minor pseudopilin GspJ -
  V6S45_RS19445 (V6S45_19445) gspK 4024781..4025764 (+) 984 WP_001058526.1 type II secretion system minor pseudopilin GspK -

Sequence


Protein


Download         Length: 493 a.a.        Molecular weight: 54622.53 Da        Isoelectric Point: 5.9849

>NTDB_id=851289 V6S45_RS19415 WP_001219899.1 4020196..4021677(+) (pilB) [Escherichia coli strain S1-SRL-01-C]
MRIHSPYPASWALAQRIGYLYSEGEIIYLADTPFERLLDIQRQVGQCQTMTSLSQADFEARLEAVFHQNTGESQQIAQDI
DQSVDLLSLSEEMPANEDLLNEDSAAPVIRLINAILSEAIKETASDIHIETYEKTMSIRFRIDGVLRTILQPNKKLAALL
ISRIKVMARLDIAEKRIPQDGRISLRIGRRNIDVRVSTLPSIYGERAVLRLLDKNSLQLSLNNLGMTAADKQDLENLIQL
PHGIILVTGPTGSGKSTTLYAILSALNTPGRNILTVEDPVEYELEGIGQTQVNTRVDMSFARGLRAILRQDPDVVMVGEI
RDTETAQIAVQASLTGHLVLSTLHTNSASGAVTRLRDMGVESFLLSSSLAGIIAQRLVRRLCPQCRQFTPVSPQQAQMFK
YHQLAVTTIGTPVGCPYCHQSGYQGRMAIHEMMVVTPELRAAIHENVDEQALERLVRQQHNALIKNGLQKVISGDTSWDE
VMRVASATLESEA

Nucleotide


Download         Length: 1482 bp        

>NTDB_id=851289 V6S45_RS19415 WP_001219899.1 4020196..4021677(+) (pilB) [Escherichia coli strain S1-SRL-01-C]
ATGAGAATTCACTCACCGTACCCCGCCAGTTGGGCGCTGGCACAACGAATTGGTTATCTCTATTCAGAGGGCGAGATTAT
TTATCTCGCCGATACGCCATTCGAACGGTTACTCGATATTCAACGTCAGGTTGGCCAGTGCCAGACCATGACCAGCTTGT
CACAGGCTGATTTTGAAGCCCGGCTGGAAGCGGTGTTCCATCAGAATACCGGTGAGTCGCAACAGATTGCGCAGGATATC
GATCAATCCGTCGATCTTCTCTCGCTTTCGGAAGAGATGCCCGCAAATGAAGATCTCCTGAATGAAGATTCAGCGGCACC
GGTTATCCGCTTGATCAATGCGATTTTGAGTGAGGCCATCAAAGAAACCGCCTCCGATATCCACATTGAAACCTATGAAA
AAACAATGTCGATCCGTTTTCGCATCGACGGCGTTTTGCGGACAATTTTACAGCCAAACAAAAAACTGGCGGCACTGCTT
ATCTCCCGAATTAAGGTCATGGCTCGTCTTGATATCGCCGAAAAACGTATTCCACAGGATGGACGTATTAGTTTGCGTAT
CGGGCGACGTAACATAGATGTCCGCGTATCCACACTGCCGTCCATCTATGGTGAACGCGCCGTGCTCCGTCTGCTGGATA
AAAACAGCCTCCAGCTTTCATTGAACAACCTGGGGATGACGGCAGCGGATAAACAGGATTTAGAAAATCTCATCCAGCTT
CCACACGGTATTATCCTGGTGACCGGACCGACAGGCTCCGGTAAAAGTACCACGCTCTACGCCATTCTTTCGGCGCTGAA
TACTCCCGGCCGCAATATTCTGACGGTAGAAGATCCCGTGGAATATGAACTGGAAGGCATAGGACAAACGCAGGTGAATA
CCCGTGTGGATATGTCTTTCGCTCGCGGCCTGCGCGCCATACTTCGCCAGGACCCGGATGTCGTCATGGTGGGGGAAATT
CGTGATACAGAAACTGCGCAGATTGCGGTTCAGGCCTCGCTCACCGGCCATCTGGTACTCTCAACACTCCACACTAACAG
CGCATCAGGCGCAGTGACCCGGCTCCGCGACATGGGCGTCGAATCATTCCTGCTTTCGTCTTCCCTGGCAGGGATTATCG
CGCAACGTCTGGTTCGTCGCCTGTGTCCGCAATGCCGACAATTCACGCCCGTATCACCCCAACAAGCGCAGATGTTTAAA
TATCATCAGCTCGCGGTGACAACAATTGGCACTCCCGTAGGCTGCCCTTATTGCCATCAATCCGGCTATCAGGGGCGCAT
GGCGATCCACGAAATGATGGTGGTGACGCCGGAATTACGGGCCGCTATTCATGAAAATGTGGATGAACAAGCACTGGAGC
GACTGGTCCGGCAACAACACAATGCCTTAATCAAAAATGGCCTGCAAAAAGTGATAAGCGGTGACACCTCCTGGGATGAG
GTTATGCGCGTCGCCAGTGCCACGCTGGAGAGCGAAGCATGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Vibrio campbellii strain DS40M4

46.682

88.641

0.414

  pilB Vibrio cholerae strain A1552

48.441

84.584

0.41

  pilB Acinetobacter baumannii D1279779

45.682

89.249

0.408

  pilB Legionella pneumophila strain ERS1305867

41.372

97.566

0.404

  pilB Vibrio parahaemolyticus RIMD 2210633

46.353

86.207

0.4

  pilB/pilB1 Synechocystis sp. PCC 6803

41.176

96.552

0.398

  pilB Acinetobacter baylyi ADP1

48.593

79.31

0.385

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

45.178

79.919

0.361

  pilF Thermus thermophilus HB27

45.063

80.122

0.361