Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   U8P30_RS11755 Genome accession   NZ_CP141084
Coordinates   2458614..2460095 (+) Length   493 a.a.
NCBI ID   WP_001219902.1    Uniprot ID   A0A0H2VD07
Organism   Escherichia coli strain KE48     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 2453614..2465095
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  U8P30_RS11735 (U8P30_11735) gspB 2453780..2454202 (-) 423 WP_000461446.1 putative general secretion pathway protein GspB -
  U8P30_RS11740 (U8P30_11740) gspA 2454204..2455673 (-) 1470 WP_000107588.1 type II secretion system protein GspA -
  U8P30_RS11745 (U8P30_11745) gspC 2455853..2456668 (+) 816 WP_001142674.1 type II secretion system protein GspC -
  U8P30_RS11750 (U8P30_11750) gspD 2456652..2458604 (+) 1953 WP_001514015.1 type II secretion system secretin GspD -
  U8P30_RS11755 (U8P30_11755) pilB 2458614..2460095 (+) 1482 WP_001219902.1 type II secretion system ATPase GspE Machinery gene
  U8P30_RS11760 (U8P30_11760) gspF 2460092..2461288 (+) 1197 WP_001109576.1 type II secretion system inner membrane protein GspF -
  U8P30_RS11765 (U8P30_11765) gspG 2461298..2461735 (+) 438 WP_001202877.1 type II secretion system major pseudopilin GspG -
  U8P30_RS11770 (U8P30_11770) gspH 2461743..2462252 (+) 510 WP_001076033.1 type II secretion system minor pseudopilin GspH -
  U8P30_RS11775 (U8P30_11775) gspI 2462249..2462626 (+) 378 WP_001041742.1 type II secretion system minor pseudopilin GspI -
  U8P30_RS11780 (U8P30_11780) gspJ 2462619..2463206 (+) 588 WP_000610637.1 type II secretion system minor pseudopilin GspJ -
  U8P30_RS11785 (U8P30_11785) gspK 2463199..2464182 (+) 984 Protein_2305 type II secretion system minor pseudopilin GspK -

Sequence


Protein


Download         Length: 493 a.a.        Molecular weight: 54738.65 Da        Isoelectric Point: 6.2412

>NTDB_id=836068 U8P30_RS11755 WP_001219902.1 2458614..2460095(+) (pilB) [Escherichia coli strain KE48]
MRIHSPYPASWALAQRIGYLYSEGEIIYLADTPFERLLDIQRQVGQCQTMTSLSQADFEARLEAVFHQNTGESQQIAQDI
DQSVDLLSLSEEMPANEDLLNEDSAAPVIRLINAILSEAIKETASDIHIETYEKTMSIRFRIDGVLRTILQPNKKLAALL
ISRIKVMARLDIAEKRIPQDGRISLRIGRRNIDVRVSTLPSIYGERTVLRLLDKNSLQLSLNNLGMTAADKQDLENLIQL
PHGIILVTGPTGSGKSTTLYAILSALNTPGRNILTVEDPVEYELEGIGQTQVNTRVDMSFARGLRAILRQDPDVVMVGEI
RDTETAQIAVQASLTGHLVLSTLHTNSASGAVTRLRDMGVESFLLSSSLAGIIAQRLVRRLCPQCRQFTPVSPQQSQMFK
YHQLAVTTIGTPVGCPHCHQSGYQGRMAIHEMMVVTPELRAAIHENVDEQALERLVRQQHNALIKNGLQKVIRGDTSWDE
VMRVASATLENEA

Nucleotide


Download         Length: 1482 bp        

>NTDB_id=836068 U8P30_RS11755 WP_001219902.1 2458614..2460095(+) (pilB) [Escherichia coli strain KE48]
ATGAGAATTCACTCACCGTACCCCGCCAGTTGGGCGCTGGCACAACGAATTGGTTATCTCTATTCAGAGGGCGAGATTAT
TTATCTCGCCGATACGCCATTCGAACGGTTACTCGATATTCAACGTCAGGTTGGCCAGTGCCAGACCATGACCAGCTTGT
CACAGGCTGATTTTGAAGCCCGGCTGGAAGCGGTGTTCCATCAGAATACCGGTGAGTCGCAACAGATTGCGCAGGATATC
GATCAATCCGTCGATCTTCTCTCGCTTTCGGAAGAGATGCCCGCAAATGAAGATCTGCTGAATGAAGATTCAGCCGCACC
GGTTATCCGCTTGATCAATGCTATTTTGAGTGAGGCCATCAAAGAAACCGCCTCCGATATCCACATTGAAACCTATGAAA
AAACAATGTCGATCCGTTTTCGCATCGACGGCGTTTTGCGGACAATTTTACAGCCCAACAAAAAACTGGCGGCACTGCTT
ATCTCCCGAATTAAGGTCATGGCGCGTCTTGATATCGCCGAAAAACGTATTCCACAGGATGGAAGAATCAGTTTGCGTAT
CGGGCGACGTAACATAGATGTCCGCGTATCCACACTGCCATCCATCTATGGTGAACGCACTGTGCTCCGCCTGCTGGATA
AAAACAGCCTCCAGCTTTCATTGAACAACCTGGGGATGACGGCAGCGGATAAACAGGATTTAGAAAATCTCATTCAGCTT
CCGCACGGTATTATCCTGGTAACAGGGCCGACAGGCTCCGGTAAAAGCACCACGCTCTACGCCATTCTTTCGGCGCTTAA
TACCCCTGGCCGTAATATTCTGACGGTAGAAGATCCCGTGGAATATGAACTGGAAGGCATAGGACAAACGCAGGTGAATA
CCCGCGTGGATATGTCTTTCGCTCGCGGCCTGCGCGCCATACTTCGCCAGGACCCGGATGTCGTCATGGTGGGGGAAATT
CGTGATACAGAAACCGCGCAAATTGCGGTTCAGGCCTCGCTCACAGGCCATCTGGTACTCTCAACACTCCACACTAACAG
TGCATCAGGCGCAGTCACCCGGCTACGCGACATGGGCGTCGAATCATTCCTGCTTTCGTCTTCACTGGCAGGGATTATCG
CGCAACGTCTGGTTCGTCGTCTGTGTCCGCAATGCCGACAATTCACGCCCGTATCGCCGCAACAATCGCAGATGTTTAAA
TATCATCAGCTCGCGGTGACAACAATTGGCACTCCCGTAGGTTGCCCTCATTGCCATCAATCCGGTTATCAGGGGCGCAT
GGCGATCCACGAAATGATGGTGGTGACGCCGGAATTGCGGGCCGCTATTCATGAAAATGTGGATGAACAAGCACTGGAGC
GACTGGTCCGGCAACAACACAATGCCTTAATCAAAAATGGCCTGCAAAAAGTGATACGCGGTGACACCTCCTGGGATGAG
GTTATGCGCGTCGCCAGTGCCACGCTGGAGAACGAAGCATGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB A0A0H2VD07

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Vibrio campbellii strain DS40M4

46.682

88.641

0.414

  pilB Vibrio cholerae strain A1552

48.681

84.584

0.412

  pilB Acinetobacter baumannii D1279779

45.909

89.249

0.41

  pilB Legionella pneumophila strain ERS1305867

41.372

97.566

0.404

  pilB Vibrio parahaemolyticus RIMD 2210633

46.353

86.207

0.4

  pilB/pilB1 Synechocystis sp. PCC 6803

41.416

94.523

0.391

  pilB Acinetobacter baylyi ADP1

48.849

79.31

0.387