Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilD   Type   Machinery gene
Locus tag   RC72_RS23325 Genome accession   NZ_CP010116
Coordinates   4527639..4528448 (-) Length   269 a.a.
NCBI ID   WP_001596192.1    Uniprot ID   -
Organism   Escherichia coli strain C1     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4522639..4533448
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  RC72_RS23310 (RC72_22175) gspD 4524096..4526156 (-) 2061 WP_073473391.1 type II secretion system secretin GspD -
  RC72_RS23315 (RC72_22180) gspC 4526186..4527145 (-) 960 WP_024190717.1 type II secretion system protein GspC -
  RC72_RS23320 (RC72_22185) gspS2 4527163..4527573 (-) 411 WP_001309757.1 type II secretion system pilot lipoprotein GspS-beta -
  RC72_RS23325 (RC72_22190) pilD 4527639..4528448 (-) 810 WP_001596192.1 prepilin peptidase PppA Machinery gene
  RC72_RS23335 (RC72_22195) sslE 4528588..4533156 (-) 4569 WP_001596195.1 lipoprotein metalloprotease SslE -

Sequence


Protein


Download         Length: 269 a.a.        Molecular weight: 29483.08 Da        Isoelectric Point: 8.3801

>NTDB_id=115151 RC72_RS23325 WP_001596192.1 4527639..4528448(-) (pilD) [Escherichia coli strain C1]
MFFDVFQQYPAAMPVLATVGGLIIGSFLNVVIWRYPIMLRQQMAEFHGEMPSTQSKISLALPRSHCPHCQQTIRVRDNIP
LLSWLMLKGRCRDCQAKISKRYPLVELLTALAFLLASLVWPESGWALAVMILSAWLIAASVIDLDNQWLPDVFTQGVLWT
GLIAAWAQQSPLTLQDAVTGVLVGFITFYSLRWIAGIVLRKEALGMGDVLLFAALGSWVGALSLPNVALIASCCGLIYAV
ITKRGSTTLPFGPCLSLGGIATLYLQALF

Nucleotide


Download         Length: 810 bp        

>NTDB_id=115151 RC72_RS23325 WP_001596192.1 4527639..4528448(-) (pilD) [Escherichia coli strain C1]
ATGTTTTTTGATGTTTTTCAGCAATACCCCGCGGCGATGCCCGTCCTGGCTACCGTCGGAGGATTGATTATCGGCAGTTT
TTTGAATGTGGTGATTTGGCGTTACCCCATCATGCTGCGCCAACAAATGGCGGAGTTTCACGGTGAAATGCCGAGTACGC
AGTCAAAAATAAGCCTGGCGCTGCCACGCTCGCACTGTCCGCATTGCCAGCAGACTATCCGCGTTCGTGACAATATTCCG
CTGCTCTCCTGGTTGATGCTCAAAGGGCGCTGCCGTGATTGTCAGGCGAAAATCAGCAAGCGTTATCCGCTGGTCGAGTT
ATTGACAGCACTCGCTTTTTTGCTGGCGAGTCTGGTCTGGCCGGAAAGTGGATGGGCGCTGGCGGTGATGATATTATCCG
CCTGGCTGATTGCTGCGAGCGTCATCGACCTCGACAACCAATGGCTGCCCGATGTTTTTACTCAGGGCGTATTGTGGACC
GGGCTGATTGCGGCATGGGCGCAACAGAGTCCGTTAACACTACAAGATGCAGTTACCGGCGTCCTGGTGGGGTTTATCAC
TTTTTACTCTCTGCGCTGGATAGCCGGAATAGTTCTGCGTAAAGAAGCATTAGGCATGGGCGATGTATTATTGTTCGCTG
CGTTAGGTAGTTGGGTGGGGGCGTTATCACTGCCCAACGTTGCTTTAATCGCCTCATGCTGCGGCCTGATATATGCCGTT
ATTACAAAAAGAGGATCAACCACACTGCCTTTTGGACCGTGTTTAAGTCTGGGCGGTATAGCAACACTTTATCTACAGGC
ATTGTTTTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilD Vibrio cholerae strain A1552

46.442

99.257

0.461

  pilD Vibrio campbellii strain DS40M4

42.066

100

0.424

  pilD Neisseria gonorrhoeae MS11

39.689

95.539

0.379

  pilD Acinetobacter nosocomialis M2

37.736

98.513

0.372

  pilD Acinetobacter baumannii D1279779

37.358

98.513

0.368


Multiple sequence alignment