Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   CNQ48_RS20530 Genome accession   NZ_CP023386
Coordinates   4027647..4029032 (+) Length   461 a.a.
NCBI ID   WP_001025166.1    Uniprot ID   -
Organism   Escherichia coli strain 1190     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4022647..4034032
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  CNQ48_RS20500 (CNQ48_20500) aroP 4023195..4024568 (+) 1374 WP_072146659.1 aromatic amino acid transporter AroP -
  CNQ48_RS20505 (CNQ48_20505) ampE 4024611..4025465 (-) 855 WP_000172019.1 beta-lactamase regulator AmpE -
  CNQ48_RS20510 (CNQ48_20510) ampD 4025462..4026013 (-) 552 WP_000923726.1 1,6-anhydro-N-acetylmuramyl-L-alanine amidase AmpD -
  CNQ48_RS20515 (CNQ48_20515) nadC 4026101..4026994 (+) 894 WP_001135190.1 carboxylating nicotinate-nucleotide diphosphorylase -
  CNQ48_RS20525 (CNQ48_20525) pilA 4027197..4027637 (+) 441 WP_000360904.1 prepilin peptidase-dependent pilin Machinery gene
  CNQ48_RS20530 (CNQ48_20530) pilB 4027647..4029032 (+) 1386 WP_001025166.1 type II secretion system protein GspE Machinery gene
  CNQ48_RS20535 (CNQ48_20535) hofC 4029022..4030224 (+) 1203 WP_000157245.1 protein transport protein HofC -
  CNQ48_RS20540 (CNQ48_20540) guaC 4030259..4031302 (-) 1044 WP_001217337.1 GMP reductase -
  CNQ48_RS25950 - 4031458..4031502 (-) 45 WP_120795372.1 protein YacM -
  CNQ48_RS20545 (CNQ48_20545) coaE 4031527..4032147 (+) 621 WP_001269517.1 dephospho-CoA kinase -
  CNQ48_RS20550 (CNQ48_20550) zapD 4032147..4032890 (+) 744 WP_001194721.1 cell division protein ZapD -
  CNQ48_RS20555 (CNQ48_20555) yacG 4032900..4033097 (+) 198 WP_000005042.1 DNA gyrase inhibitor YacG -
  CNQ48_RS20560 (CNQ48_20560) mutT 4033299..4033697 (-) 399 WP_000736017.1 8-oxo-dGTP diphosphatase MutT -

Sequence


Protein


Download         Length: 461 a.a.        Molecular weight: 50630.28 Da        Isoelectric Point: 6.5796

>NTDB_id=206818 CNQ48_RS20530 WP_001025166.1 4027647..4029032(+) (pilB) [Escherichia coli strain 1190]
MNIPQLTALCLRYQGVLLDASEEVVHVAVVDAPSHELLDALHFATTKRIEITCWTRQQMEGHASRTQQTLPVAIHEKHQP
KAELLTRTLQSALEQRASDIHIEPADNAYRIRLRIDGVLHPLPDVSPDAGVALTARLKVLGNLDIAEHRLPQDGQFTVEL
AGNAVSFRIATLPCRGGEKVVLRLLQQVSQALDVNTLGMQPLQLADFAHALQQPQGLVLVTGPTGSGKTVTLYSALQTLN
TADINICSVEDPVEIPIAGLNQTQIHPRAGLTFQGVLRALLRQDPDVIMIGEIRDGETAEIAIKAAQTGHLVLSTLHTNS
TTETLVRLQQMGVARWMLSSALTLVIAQRLVRKLCPHCRRQQGEPIHIPDNVWPSPLPHWQAPGCVHCYHGFYGRTALFE
VLPITPVIRQLISANTDVESLETHARQAGMRTLFENGCLAVEQGLTTFEELIRVLGMPHGE

Nucleotide


Download         Length: 1386 bp        

>NTDB_id=206818 CNQ48_RS20530 WP_001025166.1 4027647..4029032(+) (pilB) [Escherichia coli strain 1190]
ATGAATATTCCACAGCTCACCGCCCTGTGTCTGCGTTATCAGGGAGTCTTGCTGGATGCCAGCGAAGAGGTGGTTCATGT
TGCGGTGGTCGATGCCCCTTCGCATGAGCTACTGGACGCATTGCATTTCGCTACCACCAAACGTATTGAGATCACCTGCT
GGACGCGCCAACAAATGGAAGGTCACGCCAGTCGCACACAACAGACATTGCCCGTAGCTATTCATGAGAAGCATCAGCCC
AAAGCAGAGTTGCTGACTCGAACGTTACAATCTGCGCTGGAACAACGCGCGTCTGATATTCATATCGAACCAGCGGACAA
TGCCTACCGCATCCGCTTGCGTATCGACGGCGTATTGCATCCTTTACCGGATGTTTCACCGGATGCCGGAGTCGCATTAA
CCGCCAGATTAAAAGTGCTGGGCAACCTGGATATTGCGGAACATCGCCTGCCGCAGGACGGGCAATTCACTGTCGAACTG
GCAGGAAACGCCGTCTCATTTCGTATTGCGACCTTACCATGTCGGGGTGGTGAAAAGGTGGTATTAAGGTTGTTACAGCA
GGTGAGTCAGGCACTGGATGTCAACACGCTTGGAATGCAGCCGTTACAACTGGCGGACTTTGCTCATGCCTTGCAACAAC
CACAGGGACTGGTGCTGGTAACAGGCCCTACAGGCAGCGGCAAAACGGTCACGCTTTATAGTGCCCTGCAAACGCTGAAT
ACCGCTGACATTAATATTTGTAGCGTCGAAGATCCGGTTGAGATCCCCATAGCCGGACTAAACCAGACGCAAATCCATCC
GCGTGCCGGTCTTACCTTTCAGGGCGTTTTGCGTGCGTTATTGCGCCAGGACCCTGACGTCATCATGATCGGAGAGATCC
GCGATGGCGAAACAGCAGAGATCGCTATTAAAGCGGCGCAAACCGGTCACCTGGTGTTGTCTACCCTACACACCAATTCC
ACCACTGAAACGCTGGTACGTTTACAGCAAATGGGGGTCGCCCGCTGGATGCTCTCATCGGCGCTTACACTGGTAATAGC
CCAGCGTCTGGTACGTAAACTTTGCCCACATTGTCGCCGACAGCAAGGGGAGCCCATCCATATTCCAGACAATGTATGGC
CGTCGCCGCTGCCCCACTGGCAGGCACCCGGTTGTGTACATTGCTACCACGGTTTTTATGGTCGCACGGCCTTATTTGAA
GTTCTGCCCATAACACCGGTCATACGTCAGCTTATTTCCGCTAATACCGACGTTGAATCGCTGGAAACGCACGCCCGACA
GGCGGGTATGCGTACGCTTTTTGAAAACGGCTGCCTGGCCGTGGAGCAAGGCTTAACCACCTTTGAAGAGTTAATCCGCG
TATTGGGGATGCCGCATGGCGAGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Glaesserella parasuis strain SC1401

41.469

100

0.416

  pilB Legionella pneumophila strain ERS1305867

50

83.297

0.416

  pilB Haemophilus influenzae 86-028NP

40.127

100

0.41

  pilB Vibrio campbellii strain DS40M4

48.446

83.731

0.406

  pilB Vibrio cholerae strain A1552

46.667

84.599

0.395

  pilB Vibrio parahaemolyticus RIMD 2210633

46.41

84.599

0.393

  pilB Acinetobacter baylyi ADP1

45.478

83.948

0.382

  pilF Neisseria gonorrhoeae MS11

44.416

83.514

0.371

  pilB Acinetobacter baumannii D1279779

44.186

83.948

0.371

  pilB Haemophilus influenzae Rd KW20

44.186

83.948

0.371

  pilF Thermus thermophilus HB27

40.587

88.72

0.36


Multiple sequence alignment