Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   E3B71_RS15705 Genome accession   NZ_CP042336
Coordinates   2763780..2765273 (-) Length   497 a.a.
NCBI ID   WP_001040654.1    Uniprot ID   P10121
Organism   Escherichia coli strain GZ04-0086     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 2758780..2770273
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  E3B71_RS15680 (E3B71_13830) panM 2759003..2759386 (+) 384 WP_000778785.1 aspartate 1-decarboxylase autocleavage activator PanM -
  E3B71_RS15685 (E3B71_13835) livJ 2759585..2760688 (-) 1104 WP_001021996.1 branched chain amino acid ABC transporter substrate-binding protein LivJ -
  E3B71_RS15690 (E3B71_13840) rpoH 2760959..2761813 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  E3B71_RS15695 (E3B71_13845) ftsX 2762058..2763116 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  E3B71_RS15700 (E3B71_13850) ftsE 2763109..2763777 (-) 669 WP_000617723.1 cell division ATP-binding protein FtsE -
  E3B71_RS15705 (E3B71_13855) pilA 2763780..2765273 (-) 1494 WP_001040654.1 signal recognition particle-docking protein FtsY Machinery gene
  E3B71_RS15710 (E3B71_13860) rsmD 2765423..2766019 (+) 597 WP_000743193.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  E3B71_RS15715 (E3B71_13865) yhhL 2766009..2766278 (+) 270 WP_001295207.1 DUF1145 family protein -
  E3B71_RS15720 (E3B71_13870) yhhM 2766281..2766640 (-) 360 WP_000042900.1 DUF2500 domain-containing protein -
  E3B71_RS15725 (E3B71_13875) yhhN 2766781..2767407 (+) 627 WP_000964718.1 lysoplasmalogenase -
  E3B71_RS15730 (E3B71_13880) zntA 2767481..2769679 (+) 2199 WP_046464157.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  E3B71_RS15735 (E3B71_13885) tusA 2769781..2770026 (-) 246 WP_000130621.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 54513.35 Da        Isoelectric Point: 4.1560

>NTDB_id=331112 E3B71_RS15705 WP_001040654.1 2763780..2765273(-) (pilA) [Escherichia coli strain GZ04-0086]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIVQAQEPVKASEQAVEEQPQAHTEAEAETFAADVVEVTEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLPEDVNAEAVSPEEWQAEAETVEIVEAAEEEAAKEEITDEELETALA
AEAAEEAVMVVPPAEEEQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIADV
GVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKAPFVILMVGVNGVGKTTTIGKLARQFEQQ
GKSVMLAAGDTFRAAAVEQLQVWGQRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKKI
VRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIEDL
RPFKADDFIEALFARED

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=331112 E3B71_RS15705 WP_001040654.1 2763780..2765273(-) (pilA) [Escherichia coli strain GZ04-0086]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCGGTTGTAGAAGAAATCGTTCAGGCGCAAGAGCCTGTGAAGGCCTCTGAACAAGCCGTTGAAG
AGCAGCCGCAAGCGCATACTGAAGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTCACTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAACGTGAAGAGCTGCCGTTGCCGGAAGACGTCAACGCCGAAGCGGTTTCGCCAGAAGAGTGGCAGGCTGAAGCGGAAA
CCGTAGAGATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATTACCGACGAAGAGCTGGAAACGGCGCTGGCT
GCCGAAGCGGCAGAAGAGGCGGTGATGGTGGTTCCTCCGGCAGAAGAAGAGCAGCCGGTGGAAGAAATCGCTCAGGAGCA
GGAAAAACCGACCAAAGAAGGTTTTTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAATCTCGGTTCCGGAT
TTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAGGAGCTGGAAGAGCAGCTTTTGATCGCCGATGTG
GGTGTGGAAACCACACGTAAAATTATCACCAATCTGACGGAAGGCGCATCCCGCAAGCAGCTTCGTGACGCCGAGGCGCT
CTATGGCCTGCTGAAAGAAGAGATGGGCGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGCAAAGCGCCGT
TTGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCGCGTCAGTTTGAGCAGCAG
GGTAAATCGGTGATGCTGGCGGCGGGTGATACTTTCCGTGCAGCTGCGGTTGAACAGCTTCAGGTCTGGGGTCAGCGCAA
CAATATTCCGGTGATTGCCCAGCATACCGGGGCGGATTCCGCCTCTGTTATCTTCGACGCCATTCAGGCAGCTAAAGCGC
GTAATATCGACGTCCTGATTGCCGATACAGCCGGACGCCTGCAGAACAAATCGCACCTGATGGAAGAGTTGAAGAAAATC
GTCCGCGTGATGAAGAAACTCGACGTTGAAGCGCCGCATGAAGTTATGCTGACTATTGATGCCAGCACCGGGCAGAACGC
GGTAAGCCAGGCCAAACTGTTCCATGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGAAAG
GCGGGGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGATTTG
CGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  PDB 1FTS
  PDB 2QY9
  PDB 2XXA
  PDB 2YHS
  PDB 3ZN8
  PDB 4C7O
  PDB 5GAD
  PDB 5NCO
  PDB 5NIY
  PDB 6CQP
  PDB 6CS8
  PDB 6CVD
  PDB 6DLX
  PDB 6FPK
  PDB 6FPR
  PDB 6FQD
  PDB 6N5I
  PDB 6N5J
  PDB 6N6N
  PDB 6N9B
  PDB 6NC1
  PDB 6NC4
  PDB 7O9H

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.698

77.264

0.376