Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   LH369_RS21045 Genome accession   NZ_CP085060
Coordinates   4356210..4357703 (-) Length   497 a.a.
NCBI ID   WP_001040654.1    Uniprot ID   P10121
Organism   Escherichia coli strain P30_L1_05.20     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4351210..4362703
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  LH369_RS21020 (LH369_21020) panM 4351444..4351827 (+) 384 WP_000778768.1 aspartate 1-decarboxylase autocleavage activator PanM -
  LH369_RS21025 (LH369_21025) livJ 4352015..4353118 (-) 1104 WP_001021996.1 branched chain amino acid ABC transporter substrate-binding protein LivJ -
  LH369_RS21030 (LH369_21030) rpoH 4353389..4354243 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  LH369_RS21035 (LH369_21035) ftsX 4354488..4355546 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  LH369_RS21040 (LH369_21040) ftsE 4355539..4356207 (-) 669 WP_000617723.1 cell division ATP-binding protein FtsE -
  LH369_RS21045 (LH369_21045) pilA 4356210..4357703 (-) 1494 WP_001040654.1 signal recognition particle-docking protein FtsY Machinery gene
  LH369_RS21050 (LH369_21050) rsmD 4357853..4358449 (+) 597 WP_000743193.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  LH369_RS21055 (LH369_21055) yhhL 4358439..4358708 (+) 270 WP_001311191.1 DUF1145 family protein -
  LH369_RS21060 (LH369_21060) yhhM 4358711..4359070 (-) 360 WP_000042895.1 DUF2500 domain-containing protein -
  LH369_RS21065 (LH369_21065) yhhN 4359211..4359837 (+) 627 WP_000964718.1 lysoplasmalogenase -
  LH369_RS21070 (LH369_21070) zntA 4359911..4362109 (+) 2199 WP_000106551.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  LH369_RS21075 (LH369_21075) tusA 4362211..4362456 (-) 246 WP_000130621.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 497 a.a.        Molecular weight: 54513.35 Da        Isoelectric Point: 4.1560

>NTDB_id=536699 LH369_RS21045 WP_001040654.1 4356210..4357703(-) (pilA) [Escherichia coli strain P30_L1_05.20]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIVQAQEPVKASEQAVEEQPQAHTEAEAETFAADVVEVTEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLPEDVNAEAVSPEEWQAEAETVEIVEAAEEEAAKEEITDEELETALA
AEAAEEAVMVVPPAEEEQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIADV
GVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKAPFVILMVGVNGVGKTTTIGKLARQFEQQ
GKSVMLAAGDTFRAAAVEQLQVWGQRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKKI
VRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIEDL
RPFKADDFIEALFARED

Nucleotide


Download         Length: 1494 bp        

>NTDB_id=536699 LH369_RS21045 WP_001040654.1 4356210..4357703(-) (pilA) [Escherichia coli strain P30_L1_05.20]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCGGTTGTAGAAGAAATCGTTCAGGCGCAAGAGCCTGTGAAGGCCTCTGAACAAGCCGTTGAAG
AGCAGCCGCAAGCGCATACTGAAGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTCACTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAACGTGAAGAGCTGCCGTTGCCGGAAGACGTCAACGCCGAAGCGGTTTCGCCAGAAGAGTGGCAGGCTGAAGCGGAAA
CCGTAGAGATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATTACCGACGAAGAGCTGGAAACGGCGCTGGCT
GCCGAAGCGGCAGAAGAGGCGGTGATGGTGGTTCCTCCGGCAGAAGAAGAGCAGCCGGTGGAAGAAATCGCTCAGGAGCA
GGAAAAACCGACCAAAGAAGGTTTTTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAATCTCGGTTCCGGAT
TTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAGGAGCTGGAAGAGCAGCTTTTGATCGCCGATGTG
GGTGTGGAAACCACACGTAAAATTATCACCAATCTGACGGAAGGCGCATCCCGCAAGCAGCTTCGTGACGCCGAGGCGCT
CTATGGCCTGCTGAAAGAAGAGATGGGCGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGCAAAGCGCCGT
TTGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCGCGTCAGTTTGAGCAGCAG
GGTAAATCGGTGATGCTGGCGGCGGGTGATACTTTCCGTGCAGCTGCGGTTGAACAGCTTCAGGTCTGGGGTCAGCGCAA
CAATATTCCGGTGATTGCCCAGCATACCGGGGCGGATTCCGCCTCTGTTATCTTCGACGCCATTCAGGCAGCTAAAGCGC
GTAATATCGACGTCCTGATTGCCGATACAGCCGGACGCCTGCAGAACAAATCGCACCTGATGGAAGAGTTGAAGAAAATC
GTCCGCGTGATGAAGAAACTCGACGTTGAAGCGCCGCATGAAGTTATGCTGACTATTGATGCCAGCACCGGGCAGAACGC
GGTAAGCCAGGCCAAACTGTTCCATGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGAAAG
GCGGGGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGATTTG
CGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  PDB 1FTS
  PDB 2QY9
  PDB 2XXA
  PDB 2YHS
  PDB 3ZN8
  PDB 4C7O
  PDB 5GAD
  PDB 5NCO
  PDB 5NIY
  PDB 6CQP
  PDB 6CS8
  PDB 6CVD
  PDB 6DLX
  PDB 6FPK
  PDB 6FPR
  PDB 6FQD
  PDB 6N5I
  PDB 6N5J
  PDB 6N6N
  PDB 6N9B
  PDB 6NC1
  PDB 6NC4
  PDB 7O9H

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.698

77.264

0.376