Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilD   Type   Machinery gene
Locus tag   QUE77_RS21095 Genome accession   NZ_AP027440
Coordinates   4008797..4009606 (+) Length   269 a.a.
NCBI ID   WP_000895878.1    Uniprot ID   -
Organism   Escherichia coli strain EC556 isolate EC556     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4003797..4014606
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  QUE77_RS21090 (MUTS11_40430) sslE 4004087..4008649 (+) 4563 WP_063085216.1 lipoprotein metalloprotease SslE -
  QUE77_RS21095 (MUTS11_40440) pilD 4008797..4009606 (+) 810 WP_000895878.1 prepilin peptidase PppA Machinery gene
  QUE77_RS21100 (MUTS11_40450) gspS2 4009672..4010082 (+) 411 WP_001309757.1 type II secretion system pilot lipoprotein GspS-beta -
  QUE77_RS21105 (MUTS11_40460) gspC 4010100..4011059 (+) 960 WP_000135091.1 type II secretion system protein GspC -
  QUE77_RS21110 (MUTS11_40470) gspD 4011089..4013149 (+) 2061 WP_000498829.1 type II secretion system secretin GspD -

Sequence


Protein


Download         Length: 269 a.a.        Molecular weight: 29415.05 Da        Isoelectric Point: 8.3801

>NTDB_id=86003 QUE77_RS21095 WP_000895878.1 4008797..4009606(+) (pilD) [Escherichia coli strain EC556 isolate EC556]
MLFDVFQQYPAAMPVLATVGGLIIGSFLNVVIWRYPIMLRQQMAEFHGEMPSTQSKISLALPRSHCPHCQQTIRVRDNIP
LLSWLMLKGRCRDCQAKISKRYPLVELLTALAFLLASLVWPESGWGLAVMILSAWLIAASIIDLDNQWLPDVFTQGVLWT
GLIAAWAQQSPLTLQDAVTGVLVGFITFYSLRWIAGIVLRKEALGMGDVLLFAALGGWVGALSLPNVALIASCCGLIYAV
ITKRGSTPLPFGPCLSLGGIATLYLQALF

Nucleotide


Download         Length: 810 bp        

>NTDB_id=86003 QUE77_RS21095 WP_000895878.1 4008797..4009606(+) (pilD) [Escherichia coli strain EC556 isolate EC556]
ATGCTTTTTGATGTTTTTCAGCAATACCCCGCGGCGATGCCCGTCCTGGCTACCGTCGGAGGATTGATTATCGGCAGTTT
TTTGAATGTGGTGATTTGGCGTTACCCCATCATGCTGCGCCAACAAATGGCGGAGTTTCACGGTGAAATGCCGAGTACGC
AGTCAAAAATAAGCCTGGCGCTGCCACGCTCGCACTGTCCGCATTGCCAGCAGACTATCCGCGTTCGTGACAATATTCCG
CTGCTCTCCTGGCTGATGCTCAAAGGGCGCTGCCGCGACTGTCAGGCGAAAATCAGCAAGCGTTATCCGCTGGTGGAGTT
ATTGACGGCACTCGCTTTTTTGCTGGCGAGTCTGGTGTGGCCAGAAAGTGGATGGGGGCTGGCGGTGATGATATTATCCG
CCTGGCTGATTGCCGCGAGCATCATTGACCTCGATAACCAATGGCTGCCCGATGTTTTTACTCAGGGCGTATTGTGGACC
GGGCTGATTGCGGCATGGGCGCAGCAGAGTCCGTTAACGCTACAAGACGCAGTTACCGGCGTACTGGTGGGATTTATCAC
TTTTTACTCCCTGCGCTGGATAGCCGGAATAGTTCTGCGTAAAGAAGCATTAGGCATGGGCGATGTATTACTCTTCGCCG
CTTTAGGTGGCTGGGTGGGGGCGTTATCACTGCCCAATGTTGCTTTAATCGCCTCATGCTGCGGCCTGATATATGCCGTT
ATTACAAAAAGAGGATCAACCCCGCTGCCTTTTGGACCGTGTTTAAGTCTGGGCGGTATAGCAACACTTTATCTACAGGC
ATTGTTTTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilD Vibrio cholerae strain A1552

46.067

99.257

0.457

  pilD Vibrio campbellii strain DS40M4

42.066

100

0.424

  pilD Neisseria gonorrhoeae MS11

39.689

95.539

0.379

  pilD Acinetobacter nosocomialis M2

38.113

98.513

0.375

  pilD Acinetobacter baumannii D1279779

37.736

98.513

0.372


Multiple sequence alignment