Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   V6S37_RS01955 Genome accession   NZ_CP145663
Coordinates   418155..419636 (-) Length   493 a.a.
NCBI ID   WP_001219894.1    Uniprot ID   P45759
Organism   Escherichia coli strain S1-INA-02-A     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 413155..424636
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S37_RS01925 (V6S37_01930) gspK 414068..415051 (-) 984 WP_001058522.1 type II secretion system minor pseudopilin GspK -
  V6S37_RS01930 (V6S37_01935) gspJ 415044..415631 (-) 588 WP_000610634.1 type II secretion system minor pseudopilin GspJ -
  V6S37_RS01935 (V6S37_01940) gspI 415624..416001 (-) 378 WP_001041743.1 type II secretion system minor pseudopilin GspI -
  V6S37_RS01940 (V6S37_01945) gspH 415998..416507 (-) 510 WP_001076046.1 type II secretion system minor pseudopilin GspH -
  V6S37_RS01945 (V6S37_01950) gspG 416515..416952 (-) 438 WP_001202874.1 type II secretion system major pseudopilin GspG -
  V6S37_RS01950 (V6S37_01955) gspF 416962..418158 (-) 1197 WP_001109573.1 type II secretion system inner membrane protein GspF -
  V6S37_RS01955 (V6S37_01960) pilB 418155..419636 (-) 1482 WP_001219894.1 type II secretion system ATPase GspE Machinery gene
  V6S37_RS01960 (V6S37_01965) gspD 419646..421598 (-) 1953 WP_001326512.1 type II secretion system secretin GspD -
  V6S37_RS01965 (V6S37_01970) gspC 421582..422397 (-) 816 WP_192520810.1 type II secretion system protein GspC -
  V6S37_RS01970 (V6S37_01975) gspA 422577..424046 (+) 1470 WP_000107576.1 type II secretion system protein GspA -
  V6S37_RS01975 (V6S37_01980) gspB 424048..424467 (+) 420 WP_000461450.1 putative general secretion pathway protein GspB -

Sequence


Protein


Download         Length: 493 a.a.        Molecular weight: 54610.56 Da        Isoelectric Point: 6.2412

>NTDB_id=851827 V6S37_RS01955 WP_001219894.1 418155..419636(-) (pilB) [Escherichia coli strain S1-INA-02-A]
MRIHSPYPASWALAQRIGYLYSEGEIIYLADTPFERLLDIQRQVGQCQTMTSLSQADFEARLEAVFHQNTGESQQIAQDI
DQSVDLLSLSEEMPANEDLLNEDSAAPVIRLINAILSEAIKETASDIHIETYEKTMSIRFRIDGVLRTILQPNKKLAALL
ISRIKVMARLDIAEKRIPQDGRISLRIGRRNIDVRVSTLPSIYGERAVLRLLDKNSLQLSLNNLGMTAADKQDLENLIQL
PHGIILVTGPTGSGKSTTLYAILSALNTPGRNILTVEDPVEYELEGIGQTQVNTRVDMSFARGLRAILRQDPDVVMVGEI
RDTETAQIAVQASLTGHLVLSTLHTNSASGAVTRLRDMGVESFLLSSSLAGIIAQRLVRRLCPQCRQFTPVSPQQAQMFK
YHQLAVTTIGTPVGCPHCHQSGYQGRMAIHEMMVVTPELRAAIHENVDEQALERLVRQQHKALIKNGLQKVISGDTSWDE
VMRVASATLESEA

Nucleotide


Download         Length: 1482 bp        

>NTDB_id=851827 V6S37_RS01955 WP_001219894.1 418155..419636(-) (pilB) [Escherichia coli strain S1-INA-02-A]
ATGAGAATTCACTCACCGTACCCCGCCAGTTGGGCGCTGGCACAACGAATTGGTTATCTCTATTCAGAGGGCGAGATTAT
TTATCTCGCCGATACGCCATTCGAGCGGTTACTCGATATTCAACGTCAGGTTGGCCAGTGCCAGACCATGACCAGCTTGT
CACAGGCTGATTTTGAAGCTCGGCTGGAAGCGGTATTCCATCAGAATACCGGTGAGTCGCAACAGATTGCGCAGGATATC
GATCAATCCGTCGATCTTCTCTCGCTTTCGGAAGAGATGCCCGCAAATGAAGATCTCCTGAATGAAGATTCAGCGGCACC
GGTTATCCGCTTGATCAATGCGATTTTGAGTGAGGCCATCAAAGAAACCGCCTCTGATATCCACATTGAAACCTATGAAA
AAACAATGTCGATCCGTTTTCGCATCGACGGCGTTTTGCGGACAATTTTACAGCCAAACAAAAAACTGGCGGCACTGCTT
ATCTCCCGAATTAAGGTCATGGCTCGTCTTGATATCGCCGAAAAACGTATTCCACAGGATGGAAGAATTAGTTTGCGTAT
CGGGCGACGTAACATAGATGTCCGCGTATCCACACTGCCGTCCATCTATGGTGAACGCGCCGTACTCCGCCTGCTGGATA
AAAACAGCCTCCAGCTTTCATTGAACAACCTGGGGATGACGGCAGCGGATAAGCAGGATTTAGAAAATCTCATTCAGCTT
CCGCACGGTATTATCCTGGTGACAGGGCCGACAGGCTCCGGTAAAAGCACCACGCTCTACGCCATCCTTTCGGCGCTGAA
TACTCCCGGCCGCAATATTCTGACGGTAGAAGATCCCGTGGAATATGAGCTGGAAGGCATTGGGCAAACGCAGGTGAATA
CCCGTGTGGATATGTCTTTCGCTCGCGGCCTGCGCGCCATACTTCGCCAGGACCCGGATGTCGTCATGGTGGGGGAAATT
CGTGATACAGAAACCGCGCAGATTGCGGTTCAGGCCTCGCTCACCGGCCATCTGGTACTCTCAACACTCCACACTAACAG
TGCATCAGGCGCAGTGACCCGGCTCCGCGACATGGGCGTCGAATCATTCCTGCTTTCGTCTTCCCTGGCAGGGATTATCG
CGCAACGTCTGGTTCGTCGCCTGTGTCCGCAATGCCGACAATTCACGCCCGTATCACCCCAACAAGCGCAGATGTTTAAA
TATCATCAGCTCGCGGTGACAACAATTGGCACTCCCGTAGGCTGCCCTCATTGCCATCAATCCGGCTATCAGGGGCGCAT
GGCGATCCACGAAATGATGGTGGTGACGCCGGAATTACGGGCCGCTATTCATGAAAATGTGGATGAACAAGCACTGGAGC
GACTAGTCCGGCAACAACACAAGGCCTTAATCAAAAATGGCCTGCAAAAAGTGATAAGCGGTGACACCTCCTGGGATGAG
GTTATGCGCGTCGCCAGTGCCACGCTGGAGAGCGAAGCATGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB P45759

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Vibrio campbellii strain DS40M4

46.682

88.641

0.414

  pilB Vibrio cholerae strain A1552

48.441

84.584

0.41

  pilB Acinetobacter baumannii D1279779

45.578

89.452

0.408

  pilB Legionella pneumophila strain ERS1305867

41.372

97.566

0.404

  pilB Vibrio parahaemolyticus RIMD 2210633

46.353

86.207

0.4

  pilB/pilB1 Synechocystis sp. PCC 6803

41.176

96.552

0.398

  pilB Acinetobacter baylyi ADP1

48.338

79.31

0.383

  pilF Thermus thermophilus HB27

45.316

80.122

0.363

  pilB Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539

45.178

79.919

0.361