Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   LO740_RS21175 Genome accession   NZ_CP087294
Coordinates   4350647..4352143 (-) Length   498 a.a.
NCBI ID   WP_001040613.1    Uniprot ID   -
Organism   Escherichia coli strain APEC E956     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4345647..4357143
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  LO740_RS21150 (LO740_21100) panM 4345880..4346263 (+) 384 WP_000778791.1 aspartate 1-decarboxylase autocleavage activator PanM -
  LO740_RS21155 (LO740_21105) livJ 4346451..4347554 (-) 1104 WP_001021996.1 branched chain amino acid ABC transporter substrate-binding protein LivJ -
  LO740_RS21160 (LO740_21110) rpoH 4347826..4348680 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  LO740_RS21165 (LO740_21115) ftsX 4348925..4349983 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  LO740_RS21170 (LO740_21120) ftsE 4349976..4350644 (-) 669 WP_000617723.1 cell division ATP-binding protein FtsE -
  LO740_RS21175 (LO740_21125) pilA 4350647..4352143 (-) 1497 WP_001040613.1 signal recognition particle-docking protein FtsY Machinery gene
  LO740_RS21180 (LO740_21130) rsmD 4352293..4352889 (+) 597 WP_000743193.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  LO740_RS21185 (LO740_21135) yhhL 4352879..4353148 (+) 270 WP_001295207.1 DUF1145 family protein -
  LO740_RS21190 (LO740_21140) yhhM 4353151..4353510 (-) 360 WP_000042885.1 DUF2500 domain-containing protein -
  LO740_RS21195 (LO740_21145) yhhN 4353651..4354277 (+) 627 WP_000964718.1 lysoplasmalogenase -
  LO740_RS21200 (LO740_21150) zntA 4354351..4356549 (+) 2199 WP_000106587.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  LO740_RS21205 (LO740_21155) tusA 4356818..4357063 (-) 246 WP_000130619.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 498 a.a.        Molecular weight: 54620.36 Da        Isoelectric Point: 4.1639

>NTDB_id=544586 LO740_RS21175 WP_001040613.1 4350647..4352143(-) (pilA) [Escherichia coli strain APEC E956]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIAQAQEPAKASEHAVEEQPQAHTEAEAETFAADVVEVSEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLPEDVNAEEVSPEEWQAEAETVEIVEAAEEEAAKEEITDEELEAQAL
AAEAAEEAVIVVPPAEEEQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIAD
VGVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKTPFVILMVGVNGVGKTTTIGKLARQFEQ
QGKSVMLAAGDTFRAAAVEQLQVWGQRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKK
IVRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIED
LRPFKADDFIEALFARED

Nucleotide


Download         Length: 1497 bp        

>NTDB_id=544586 LO740_RS21175 WP_001040613.1 4350647..4352143(-) (pilA) [Escherichia coli strain APEC E956]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCGGTTGTAGAAGAAATCGCTCAGGCGCAAGAGCCTGCGAAGGCTTCTGAACACGCCGTTGAAG
AGCAGCCGCAGGCGCATACTGAAGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTCTCTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAGCGTGAAGAGCTGCCGTTGCCGGAAGACGTCAACGCCGAAGAGGTTTCGCCAGAAGAGTGGCAGGCTGAAGCGGAAA
CCGTAGAGATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATCACCGACGAAGAGCTGGAAGCACAGGCGCTG
GCTGCCGAAGCGGCAGAAGAAGCGGTGATAGTGGTTCCTCCGGCAGAAGAAGAGCAGCCGGTGGAAGAAATCGCTCAGGA
GCAGGAAAAACCAACCAAAGAAGGTTTCTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAACCTCGGTTCCG
GATTTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAAGAGCTGGAAGAACAGCTGTTGATCGCCGAT
GTGGGTGTGGAAACCACACGTAAAATTATCACCAATCTGACGGAAGGCGCATCCCGCAAGCAGCTTCGTGATGCCGAGGC
GCTTTATGGCCTGCTGAAAGAAGAGATGGGCGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGTAAAACGC
CGTTCGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCACGTCAGTTTGAGCAG
CAGGGTAAATCGGTGATGCTGGCGGCGGGCGATACTTTCCGTGCGGCAGCGGTTGAACAGCTTCAGGTCTGGGGTCAGCG
CAACAATATTCCGGTGATTGCCCAGCATACCGGGGCGGATTCCGCCTCTGTTATCTTCGACGCCATTCAGGCAGCTAAAG
CGCGTAATATCGACGTCCTGATTGCCGATACCGCCGGACGCCTGCAGAACAAATCGCACCTGATGGAAGAGTTGAAGAAA
ATCGTCCGCGTGATGAAGAAACTCGACGTTGAAGCGCCGCATGAAGTTATGCTGACTATTGATGCCAGCACCGGGCAGAA
CGCGGTAAGCCAGGCCAAACTGTTCCATGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGA
AAGGCGGAGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGAT
TTGCGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.831

77.309

0.378