Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   V6S34_RS12020 Genome accession   NZ_CP145671
Coordinates   2383408..2384793 (+) Length   461 a.a.
NCBI ID   WP_001025168.1    Uniprot ID   -
Organism   Escherichia coli strain S1-ZIM-01-A     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 2378408..2389793
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S34_RS11995 (V6S34_11995) aroP 2378956..2380329 (+) 1374 WP_000969912.1 aromatic amino acid transporter AroP -
  V6S34_RS12000 (V6S34_12000) ampE 2380372..2381226 (-) 855 WP_000172005.1 beta-lactamase regulator AmpE -
  V6S34_RS12005 (V6S34_12005) ampD 2381223..2381774 (-) 552 WP_000923726.1 1,6-anhydro-N-acetylmuramyl-L-alanine amidase AmpD -
  V6S34_RS12010 (V6S34_12010) nadC 2381862..2382755 (+) 894 WP_001135167.1 carboxylating nicotinate-nucleotide diphosphorylase -
  V6S34_RS12015 (V6S34_12015) pilA 2382958..2383398 (+) 441 WP_000360904.1 prepilin peptidase-dependent pilin Machinery gene
  V6S34_RS12020 (V6S34_12020) pilB 2383408..2384793 (+) 1386 WP_001025168.1 type II secretion system protein GspE Machinery gene
  V6S34_RS12025 (V6S34_12025) hofC 2384783..2385985 (+) 1203 WP_000157287.1 protein transport protein HofC -
  V6S34_RS12030 (V6S34_12030) guaC 2386020..2387063 (-) 1044 WP_001217337.1 GMP reductase -
  V6S34_RS12035 (V6S34_12035) - 2387219..2387263 (-) 45 WP_120795372.1 protein YacM -
  V6S34_RS12040 (V6S34_12040) coaE 2387288..2387908 (+) 621 WP_001269513.1 dephospho-CoA kinase -
  V6S34_RS12045 (V6S34_12045) zapD 2387908..2388651 (+) 744 WP_001194720.1 cell division protein ZapD -
  V6S34_RS12050 (V6S34_12050) yacG 2388661..2388858 (+) 198 WP_000005042.1 DNA gyrase inhibitor YacG -
  V6S34_RS12055 (V6S34_12055) mutT 2388946..2389344 (-) 399 WP_000736038.1 8-oxo-dGTP diphosphatase MutT -

Sequence


Protein


Download         Length: 461 a.a.        Molecular weight: 50614.28 Da        Isoelectric Point: 6.5405

>NTDB_id=852006 V6S34_RS12020 WP_001025168.1 2383408..2384793(+) (pilB) [Escherichia coli strain S1-ZIM-01-A]
MNIPQLTALCLRYQGVLLDASEEVVHVAVVDAPSHELLDALHFATTKRIEITCWTRQQMEGHASRTQQTLPVAIHEKHQP
KAELLTRTLQSALEQRASDIHIEPADNAYRIRLRIDGVLHPLPDVSPDVGVALTARLKVLGNLDIAEHRLPQDGQFTVEL
AGNAVSFRIATLPCRGGEKVVLRLLQQVSQALDVNTLGMQPLQLADFAHALQQPQGLVLVTGPTGSGKTVTLYSALQTLN
TADINICSVEDPVEIPIAGLNQTQIHPRAGLTFQGVLRALLRQDPDVIMIGEIRDGETAEIAIKAAQTGHLVLSTLHTNS
TTETLVRLQQMGVARWMLSSALTLVIAQRLVRKLCPHCRLQQGESIHIPDNVWSSPLPRWQAPGCVHCYHGFYGRTALFE
VLPITPVIRQLISANTDVESLETHARQAGMRTLFENGCLAVEQGLTTFEELIRVLGMPHGE

Nucleotide


Download         Length: 1386 bp        

>NTDB_id=852006 V6S34_RS12020 WP_001025168.1 2383408..2384793(+) (pilB) [Escherichia coli strain S1-ZIM-01-A]
ATGAATATTCCACAGCTCACCGCCCTGTGTCTGCGTTATCAGGGAGTCTTGCTGGATGCCAGCGAAGAGGTGGTTCATGT
TGCGGTGGTCGATGCCCCTTCGCATGAGCTACTAGACGCATTGCATTTCGCTACCACCAAACGTATTGAGATCACCTGCT
GGACGCGCCAACAAATGGAAGGTCACGCCAGTCGCACACAACAGACATTGCCCGTAGCTATTCATGAGAAGCATCAGCCC
AAAGCAGAGTTGCTGACTCGAACGCTACAATCTGCGCTGGAACAACGCGCGTCTGATATTCATATCGAACCAGCGGACAA
TGCCTACCGCATCCGCTTGCGTATCGACGGCGTATTGCATCCTTTACCGGATGTTTCACCGGATGTCGGAGTCGCATTAA
CCGCCAGATTAAAAGTGCTGGGCAACCTGGATATTGCGGAACATCGCCTGCCGCAGGACGGGCAATTCACTGTCGAACTG
GCAGGAAACGCCGTCTCATTTCGTATTGCGACCTTACCATGTCGGGGTGGTGAAAAGGTGGTATTAAGGTTGTTACAGCA
GGTGAGTCAGGCACTGGATGTCAACACGCTTGGAATGCAGCCGTTACAACTGGCGGACTTTGCTCATGCCTTGCAACAAC
CACAGGGACTGGTGCTGGTAACAGGCCCTACAGGCAGCGGCAAAACGGTCACGCTTTATAGTGCCCTGCAAACGCTGAAT
ACCGCTGACATTAATATTTGTAGCGTCGAAGATCCGGTTGAGATCCCCATAGCCGGACTAAACCAGACGCAAATCCATCC
GCGTGCCGGACTCACCTTTCAGGGCGTTTTGCGTGCGTTATTGCGCCAGGACCCTGACGTCATTATGATCGGAGAGATCC
GCGATGGCGAAACAGCAGAGATCGCTATTAAAGCGGCGCAAACCGGTCACCTGGTGTTGTCTACCCTACACACCAATTCC
ACCACTGAAACGCTGGTACGTTTACAGCAAATGGGAGTCGCCCGCTGGATGCTCTCATCAGCGCTTACACTGGTAATAGC
CCAGCGTCTGGTACGCAAACTTTGCCCACATTGTCGCCTGCAGCAAGGGGAGTCCATCCATATTCCAGACAATGTATGGT
CGTCGCCGCTGCCCCGCTGGCAAGCACCCGGTTGTGTACATTGCTACCACGGTTTTTATGGTCGTACGGCCTTATTTGAA
GTTCTACCCATAACACCGGTCATACGCCAGCTTATTTCCGCTAATACCGACGTTGAATCGCTGGAAACGCACGCCCGACA
GGCGGGTATGCGTACGCTTTTTGAAAACGGCTGCCTGGCCGTGGAGCAAGGCTTAACCACCTTTGAAGAGTTAATCCGCG
TATTGGGGATGCCGCATGGCGAGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Glaesserella parasuis strain SC1401

41.469

100

0.416

  pilB Legionella pneumophila strain ERS1305867

49.738

82.863

0.412

  pilB Haemophilus influenzae 86-028NP

40.127

100

0.41

  pilB Vibrio campbellii strain DS40M4

48.052

83.514

0.401

  pilB Vibrio parahaemolyticus RIMD 2210633

46.667

84.599

0.395

  pilB Vibrio cholerae strain A1552

47.15

83.731

0.395

  pilF Neisseria gonorrhoeae MS11

44.56

83.731

0.373

  pilB Acinetobacter baylyi ADP1

44.301

83.731

0.371

  pilB Haemophilus influenzae Rd KW20

44.186

83.948

0.371

  pilB Acinetobacter baumannii D1279779

44.125

83.08

0.367