Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilB   Type   Machinery gene
Locus tag   GR930_RS04915 Genome accession   NZ_AP022351
Coordinates   1009555..1010940 (-) Length   461 a.a.
NCBI ID   WP_001025180.1    Uniprot ID   A0A0H2V435
Organism   Escherichia coli strain E138     
Function   type IV pilus biogenesis and function (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1004555..1015940
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GR930_RS04885 (RIMDOsaka138_09360) mutT 1005004..1005402 (+) 399 WP_000736048.1 8-oxo-dGTP diphosphatase MutT -
  GR930_RS04890 (RIMDOsaka138_09370) yacG 1005490..1005687 (-) 198 WP_000005042.1 DNA gyrase inhibitor YacG -
  GR930_RS04895 (RIMDOsaka138_09380) zapD 1005697..1006440 (-) 744 WP_001194731.1 cell division protein ZapD -
  GR930_RS04900 (RIMDOsaka138_09390) coaE 1006440..1007060 (-) 621 WP_001269520.1 dephospho-CoA kinase -
  GR930_RS23325 - 1007085..1007129 (+) 45 WP_120795372.1 protein YacM -
  GR930_RS04905 (RIMDOsaka138_09400) guaC 1007285..1008328 (+) 1044 WP_001217320.1 GMP reductase -
  GR930_RS04910 (RIMDOsaka138_09410) hofC 1008363..1009565 (-) 1203 WP_000157289.1 protein transport protein HofC -
  GR930_RS04915 (RIMDOsaka138_09420) pilB 1009555..1010940 (-) 1386 WP_001025180.1 type II secretion system protein GspE Machinery gene
  GR930_RS04920 (RIMDOsaka138_09430) pilA 1010950..1011390 (-) 441 WP_000360914.1 prepilin peptidase-dependent pilin Machinery gene
  GR930_RS04925 (RIMDOsaka138_09440) nadC 1011594..1012487 (-) 894 WP_001135168.1 carboxylating nicotinate-nucleotide diphosphorylase -
  GR930_RS04930 (RIMDOsaka138_09450) ampD 1012575..1013126 (+) 552 WP_000923703.1 1,6-anhydro-N-acetylmuramyl-L-alanine amidase AmpD -
  GR930_RS04935 (RIMDOsaka138_09460) ampE 1013123..1013977 (+) 855 WP_000171980.1 beta-lactamase regulator AmpE -
  GR930_RS04940 (RIMDOsaka138_09470) aroP 1014020..1015390 (-) 1371 WP_000399017.1 aromatic amino acid transporter AroP -

Sequence


Protein


Download         Length: 461 a.a.        Molecular weight: 50602.20 Da        Isoelectric Point: 6.5396

>NTDB_id=67582 GR930_RS04915 WP_001025180.1 1009555..1010940(-) (pilB) [Escherichia coli strain E138]
MNIPQLTALCLRYQGVLLDASEEVVHVAVVDAPSHELLDALHFATTKRIEITCWTRQQMEGHASRTQQTLPVAVQEKHQP
KAELLTRTLQSALEQRASDIHIEPADNAYRIRLRIDGVLHPLPDVSPDAGVALTARLKVLGNLDIAEHRLPQDGQFTVEL
AGNAVSFRIATLACRGGEKVVLRLLQQVNQALDVNTLGMQPSQLVDFAHALQQPQGLVLVTGPTGSGKTVTLYSALQTLN
TADINICSVEDPVEIPIAGLNQTQIHSRAGLTFQGVLRALLRQDPDVIMIGEIRDGETAEIAIKAAQTGHLVLSTLHTNS
TCETLVRLQQMGVARWMLSSALTLVIAQRLVRKLCPHCRRQQGEPIHIPDNVWPSPLPHWQAPGCVHCYHGFYGRTALFE
VLPITPVIRQLISANTDVESLETHARQAGMRTLFENGCLAVEQGLTTFEELIRVLGMPHGE

Nucleotide


Download         Length: 1386 bp        

>NTDB_id=67582 GR930_RS04915 WP_001025180.1 1009555..1010940(-) (pilB) [Escherichia coli strain E138]
ATGAATATTCCACAGCTCACTGCCCTGTGTCTGCGTTATCAGGGAGTCTTGCTGGATGCCAGCGAAGAGGTGGTTCATGT
TGCGGTAGTCGATGCACCTTCGCATGAGCTACTGGACGCATTGCATTTCGCTACCACCAAACGTATTGAGATCACCTGCT
GGACGCGCCAACAAATGGAAGGTCACGCCAGTCGCACACAACAGACATTGCCCGTAGCTGTTCAGGAGAAGCATCAGCCC
AAAGCAGAGTTGCTGACTCGAACGTTACAATCTGCGCTAGAACAACGCGCGTCTGATATTCATATCGAACCAGCGGACAA
TGCCTACCGCATCCGCTTGCGTATCGACGGCGTATTGCATCCTTTACCGGACGTTTCACCGGATGCCGGAGTCGCATTAA
CCGCCAGATTAAAAGTGCTGGGAAACCTGGATATTGCGGAACATCGCCTGCCGCAGGACGGGCAATTCACTGTCGAACTG
GCAGGAAACGCCGTCTCATTTCGTATTGCGACCTTAGCATGTCGGGGTGGTGAAAAGGTGGTATTAAGGTTGTTACAGCA
GGTGAACCAGGCACTGGATGTTAACACGCTTGGAATGCAGCCGTCACAACTGGTGGACTTTGCTCATGCCTTGCAACAAC
CACAGGGACTGGTGCTGGTAACTGGCCCTACAGGCAGCGGCAAAACGGTCACGCTTTATAGTGCCCTGCAAACGCTGAAT
ACCGCTGACATTAATATTTGTAGCGTCGAAGATCCGGTTGAGATCCCCATAGCCGGATTAAACCAGACGCAAATCCATTC
GCGTGCCGGACTCACCTTTCAGGGCGTTTTGCGTGCGTTATTGCGCCAGGATCCTGACGTCATCATGATCGGAGAGATCC
GCGATGGCGAAACGGCAGAAATTGCCATAAAAGCCGCGCAAACCGGTCACCTGGTGTTGTCTACCCTACACACTAATTCC
ACCTGCGAAACGCTGGTACGTTTACAGCAAATGGGAGTCGCCCGCTGGATGCTATCATCGGCGCTTACGCTGGTAATAGC
CCAGCGTCTGGTACGCAAACTTTGCCCGCATTGTCGCCGGCAGCAAGGGGAGCCCATCCATATTCCAGACAATGTATGGC
CGTCGCCGCTGCCCCACTGGCAGGCACCCGGTTGTGTACATTGCTACCACGGTTTTTATGGTCGCACGGCCTTATTTGAA
GTTCTGCCCATAACACCGGTCATACGTCAGCTTATTTCCGCTAATACCGACGTTGAATCGCTGGAAACGCACGCCCGACA
GGCGGGTATGCGAACGCTTTTTGAAAACGGCTGCCTGGCTGTGGAGCAAGGCTTAACCACCTTTGAAGAGTTAATCCGCG
TATTGGGGATGCCGCATGGCGAGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB A0A0H2V435

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilB Glaesserella parasuis strain SC1401

41.037

100

0.412

  pilB Legionella pneumophila strain ERS1305867

49.479

83.297

0.412

  pilB Acinetobacter baylyi ADP1

39.53

100

0.401

  pilB Vibrio campbellii strain DS40M4

47.927

83.731

0.401

  pilB Vibrio cholerae strain A1552

46.154

84.599

0.39

  pilB Vibrio parahaemolyticus RIMD 2210633

45.641

84.599

0.386

  pilB Haemophilus influenzae 86-028NP

44.703

83.948

0.375

  pilB Haemophilus influenzae Rd KW20

43.928

83.948

0.369

  pilF Neisseria gonorrhoeae MS11

44.156

83.514

0.369

  pilB Acinetobacter baumannii D1279779

42.893

85.466

0.367


Multiple sequence alignment