Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   V6S42_RS20260 Genome accession   NZ_CP145646
Coordinates   4182893..4184278 (+) Length   461 a.a.
NCBI ID   WP_022645178.1    Uniprot ID   -
Organism   Escherichia coli strain S1-IND-02-A     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4177893..4189278
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S42_RS20235 (V6S42_20235) aroP 4178441..4179814 (+) 1374 WP_000969915.1 aromatic amino acid transporter AroP -
  V6S42_RS20240 (V6S42_20240) ampE 4179857..4180711 (-) 855 WP_000172019.1 beta-lactamase regulator AmpE -
  V6S42_RS20245 (V6S42_20245) ampD 4180708..4181259 (-) 552 WP_022645179.1 1,6-anhydro-N-acetylmuramyl-L-alanine amidase AmpD -
  V6S42_RS20250 (V6S42_20250) nadC 4181347..4182240 (+) 894 WP_001135167.1 carboxylating nicotinate-nucleotide diphosphorylase -
  V6S42_RS20255 (V6S42_20255) pilA 4182443..4182883 (+) 441 WP_000360914.1 prepilin peptidase-dependent pilin Machinery gene
  V6S42_RS20260 (V6S42_20260) pilB 4182893..4184278 (+) 1386 WP_022645178.1 type II secretion system protein GspE Machinery gene
  V6S42_RS20265 (V6S42_20265) hofC 4184268..4185470 (+) 1203 WP_022645177.1 protein transport protein HofC -
  V6S42_RS20270 (V6S42_20270) guaC 4185505..4186548 (-) 1044 WP_001217337.1 GMP reductase -
  V6S42_RS20275 (V6S42_20275) - 4186704..4186748 (-) 45 WP_120795372.1 protein YacM -
  V6S42_RS20280 (V6S42_20280) coaE 4186773..4187393 (+) 621 WP_022645176.1 dephospho-CoA kinase -
  V6S42_RS20285 (V6S42_20285) zapD 4187393..4188136 (+) 744 WP_001194731.1 cell division protein ZapD -
  V6S42_RS20290 (V6S42_20290) yacG 4188146..4188343 (+) 198 WP_000005042.1 DNA gyrase inhibitor YacG -
  V6S42_RS20295 (V6S42_20295) mutT 4188442..4188831 (-) 390 WP_022645175.1 8-oxo-dGTP diphosphatase MutT -

Sequence


Protein


Download         Length: 461 a.a.        Molecular weight: 50712.40 Da        Isoelectric Point: 6.5399

>NTDB_id=851548 V6S42_RS20260 WP_022645178.1 4182893..4184278(+) (pilB) [Escherichia coli strain S1-IND-02-A]
MNIPQLTALCLRYQGVLLDASEEVVHVAVVDAPSHELLDALHFATTKRIEITCWTRQQMEGHASRTQQTLPVAVQEKHQP
KAELLTRTLQSALEQRASDIHIEPADNAYRIRLRIDGVLHPLPDVSPDAGVALTARLKVLGNLDIAEHRLPQDGQFTVEL
AGNAVSFRIATLPCRGGEKVVLRLLQQVSQALDVNKLGMQPLQLADFAHALQQPQGLVLVTGPTGSGKTVTLYSALQTLN
TADINICSVEDPVEIPIAGLNQTQIHSRAGLTFQGVLRALLRQDPDVIMIGEIRDGETAEIAIKAAQTGHLVLSTLHTNS
TCETLVRLQQMGVARWMLSSALTLVIAQRLVRKLCPHCRRQQEEPIHIPDNVWPSPLPHWQAPGCVHCYHGFYGRTALFE
VLPITPIIRQLISANTDVESLETHARQAGMRTLFENGCLAVEQGLTTFEELIRVLGMPHGE

Nucleotide


Download         Length: 1386 bp        

>NTDB_id=851548 V6S42_RS20260 WP_022645178.1 4182893..4184278(+) (pilB) [Escherichia coli strain S1-IND-02-A]
ATGAATATTCCACAGCTCACCGCCCTGTGTCTGCGTTATCAGGGAGTCTTGCTGGATGCCAGCGAAGAGGTGGTTCATGT
TGCGGTAGTCGATGCACCTTCGCATGAGCTACTGGACGCATTGCATTTCGCTACCACCAAACGTATTGAGATCACCTGCT
GGACGCGCCAACAAATGGAAGGTCACGCCAGTCGCACACAACAGACATTGCCCGTAGCTGTTCAGGAGAAGCATCAGCCC
AAAGCAGAGTTGCTGACTCGAACGTTACAGTCTGCGCTGGAACAACGCGCGTCTGATATTCATATCGAACCAGCGGACAA
TGCCTACCGCATCCGCTTGCGTATCGACGGCGTATTGCATCCTTTACCGGACGTTTCACCGGATGCCGGAGTCGCATTAA
CCGCCAGATTAAAAGTGCTGGGAAATCTGGATATTGCGGAACATCGCCTGCCGCAGGACGGGCAATTCACTGTCGAACTG
GCAGGAAACGCCGTCTCATTTCGTATTGCGACCTTACCATGCCGGGGTGGTGAAAAGGTGGTATTAAGGTTGTTACAGCA
GGTGAGCCAGGCACTGGATGTCAACAAGCTGGGGATGCAGCCGTTACAACTGGCGGACTTTGCTCATGCCTTGCAACAAC
CACAGGGACTGGTGCTGGTAACTGGCCCTACAGGCAGCGGCAAAACGGTCACGCTTTATAGTGCCCTGCAAACGCTGAAT
ACCGCTGACATTAATATTTGTAGCGTCGAAGATCCGGTTGAGATCCCCATAGCCGGACTAAACCAGACGCAAATCCATTC
GCGTGCCGGTCTTACCTTTCAGGGCGTTTTGCGTGCGTTATTGCGCCAGGACCCTGACGTCATCATGATCGGAGAGATCC
GCGATGGCGAAACGGCAGAAATTGCCATAAAAGCCGCGCAAACCGGTCACCTGGTGTTGTCCACGCTACACACCAATTCC
ACCTGCGAAACGCTGGTGCGTTTACAGCAAATGGGCGTTGCTCGCTGGATGCTCTCATCGGCACTTACGCTGGTAATAGC
CCAGCGTCTGGTACGTAAACTTTGCCCACATTGTCGCCGACAGCAAGAGGAGCCCATCCATATTCCAGACAATGTATGGC
CGTCGCCGCTGCCCCACTGGCAAGCACCCGGTTGTGTACATTGCTACCACGGTTTTTATGGTCGTACGGCCTTATTTGAA
GTTCTACCCATAACACCGATCATACGCCAGCTTATTTCCGCTAATACCGACGTTGAATCGCTGGAAACACACGCCCGACA
GGCGGGTATGCGTACGCTTTTTGAAAACGGCTGCCTGGCCGTGGAGCAAGGCTTAACCACCTTTGAAGAGTTAATCCGCG
TATTGGGGATGCCGCATGGCGAGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Legionella pneumophila strain ERS1305867

49.74

83.297

0.414

  pilB Glaesserella parasuis strain SC1401

41.253

100

0.414

  pilB Acinetobacter baylyi ADP1

40.171

100

0.408

  pilB Vibrio campbellii strain DS40M4

48.312

83.514

0.403

  pilB Vibrio parahaemolyticus RIMD 2210633

46.667

84.599

0.395

  pilB Vibrio cholerae strain A1552

46.891

83.731

0.393

  pilB Haemophilus influenzae 86-028NP

44.703

83.948

0.375

  pilB Acinetobacter baumannii D1279779

43.655

85.466

0.373

  pilF Neisseria gonorrhoeae MS11

44.675

83.514

0.373

  pilB Haemophilus influenzae Rd KW20

44.186

83.948

0.371

  pilF Thermus thermophilus HB27

40.786

88.286

0.36