Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   KQ220_RS18900 Genome accession   NZ_CP076709
Coordinates   3903092..3904588 (-) Length   498 a.a.
NCBI ID   WP_001040618.1    Uniprot ID   -
Organism   Escherichia coli O158:H23 strain CFIAFB20140388     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 3898092..3909588
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  KQ220_RS18875 (KQ220_18875) panM 3898313..3898696 (+) 384 WP_096930762.1 aspartate 1-decarboxylase autocleavage activator PanM -
  KQ220_RS18880 (KQ220_18880) livJ 3898896..3899999 (-) 1104 WP_001350438.1 branched chain amino acid ABC transporter substrate-binding protein LivJ -
  KQ220_RS18885 (KQ220_18885) rpoH 3900271..3901125 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  KQ220_RS18890 (KQ220_18890) ftsX 3901370..3902428 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  KQ220_RS18895 (KQ220_18895) ftsE 3902421..3903089 (-) 669 WP_000617723.1 cell division ATP-binding protein FtsE -
  KQ220_RS18900 (KQ220_18900) pilA 3903092..3904588 (-) 1497 WP_001040618.1 signal recognition particle-docking protein FtsY Machinery gene
  KQ220_RS18905 (KQ220_18905) rsmD 3904738..3905334 (+) 597 WP_000743193.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  KQ220_RS18910 (KQ220_18910) yhhL 3905324..3905593 (+) 270 WP_048971491.1 DUF1145 family protein -
  KQ220_RS18915 (KQ220_18915) yhhM 3905596..3905955 (-) 360 WP_048971489.1 DUF2500 domain-containing protein -
  KQ220_RS18920 (KQ220_18920) yhhN 3906096..3906722 (+) 627 WP_000964718.1 lysoplasmalogenase -
  KQ220_RS18925 (KQ220_18925) zntA 3906796..3908994 (+) 2199 WP_112005952.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  KQ220_RS18930 (KQ220_18930) tusA 3909096..3909341 (-) 246 WP_000130621.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 498 a.a.        Molecular weight: 54640.45 Da        Isoelectric Point: 4.1468

>NTDB_id=504332 KQ220_RS18900 WP_001040618.1 3903092..3904588(-) (pilA) [Escherichia coli O158:H23 strain CFIAFB20140388]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIVPAQEPAKASEQAVEEQPQAHTEAEAETFAADVVEVTEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLPEDVNAEEVSPEEWQAEAETVEIVEAAEEEAAKEEITDEELEAQAL
AAEAAEEAVMVVPPAEEEQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIAD
VGVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKTPFVILMVGVNGVGKTTTIGKLARQFEQ
QGKSVMLAAGDTFRAAAVEQLQVWGQRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKK
IVRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIED
LRPFKADDFIEALFARED

Nucleotide


Download         Length: 1497 bp        

>NTDB_id=504332 KQ220_RS18900 WP_001040618.1 3903092..3904588(-) (pilA) [Escherichia coli O158:H23 strain CFIAFB20140388]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCGGTTGTAGAAGAAATCGTTCCGGCGCAAGAGCCTGCGAAGGCTTCTGAACAAGCCGTTGAAG
AGCAGCCGCAGGCGCATACTGAGGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTCACTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAGCGTGAAGAGCTGCCGTTGCCGGAAGACGTCAACGCCGAAGAGGTTTCGCCAGAAGAGTGGCAGGCCGAAGCGGAAA
CCGTAGAGATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATCACCGATGAAGAGCTGGAAGCACAGGCGCTG
GCTGCCGAAGCAGCAGAAGAGGCGGTGATGGTGGTTCCTCCGGCAGAAGAAGAGCAGCCGGTGGAAGAAATCGCTCAGGA
GCAGGAAAAACCGACCAAAGAAGGTTTCTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAATCTCGGTTCCG
GATTTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAGGAGCTGGAAGAGCAGCTGTTGATCGCCGAT
GTGGGCGTGGAAACCACACGTAAAATTATCACCAATCTGACGGAAGGCGCATCCCGCAAGCAGCTTCGTGATGCCGAGGC
GCTCTATGGCCTGCTGAAAGAAGAGATGGGTGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGTAAAACGC
CGTTTGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCACGTCAGTTTGAGCAG
CAGGGTAAATCGGTGATGCTGGCGGCGGGCGATACTTTCCGTGCAGCAGCGGTTGAGCAGCTTCAGGTCTGGGGTCAGCG
CAACAATATTCCGGTGATTGCACAGCATACCGGGGCGGATTCCGCCTCTGTTATCTTCGACGCCATTCAGGCAGCTAAAG
CGCGTAATATCGACGTCCTGATTGCCGATACCGCCGGACGCCTGCAGAACAAATCGCACCTGATGGAAGAGTTGAAGAAA
ATCGTCCGCGTGATGAAGAAACTCGACGTTGAAGCGCCGCATGAAGTTATGCTGACTATTGATGCCAGCACCGGGCAGAA
CGCGGTAAGCCAGGCCAAACTGTTCCACGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGA
AAGGCGGGGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGAT
TTGCGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.831

77.309

0.378