Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   KQ258_RS19210 Genome accession   NZ_CP076687
Coordinates   3908747..3910243 (-) Length   498 a.a.
NCBI ID   WP_001040681.1    Uniprot ID   -
Organism   Escherichia coli strain S22EC     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 3903747..3915243
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  KQ258_RS19185 (KQ258_19180) ataR 3904137..3904403 (-) 267 WP_001277107.1 type II toxin-antitoxin system antitoxin AtaR -
  KQ258_RS19190 (KQ258_19185) livJ 3904552..3905655 (-) 1104 WP_001021994.1 branched chain amino acid ABC transporter substrate-binding protein LivJ -
  KQ258_RS19195 (KQ258_19190) rpoH 3905926..3906780 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  KQ258_RS19200 (KQ258_19195) ftsX 3907025..3908083 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  KQ258_RS19205 (KQ258_19200) ftsE 3908076..3908744 (-) 669 WP_000617723.1 cell division ATP-binding protein FtsE -
  KQ258_RS19210 (KQ258_19205) pilA 3908747..3910243 (-) 1497 WP_001040681.1 signal recognition particle-docking protein FtsY Machinery gene
  KQ258_RS19215 (KQ258_19210) rsmD 3910393..3910989 (+) 597 WP_000743189.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  KQ258_RS19220 (KQ258_19215) yhhL 3910979..3911248 (+) 270 WP_001295207.1 DUF1145 family protein -
  KQ258_RS19225 (KQ258_19220) yhhM 3911251..3911610 (-) 360 WP_000042886.1 DUF2500 domain-containing protein -
  KQ258_RS19230 (KQ258_19225) yhhN 3911751..3912377 (+) 627 WP_000964718.1 lysoplasmalogenase -
  KQ258_RS19235 (KQ258_19230) zntA 3912451..3914649 (+) 2199 WP_000106599.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  KQ258_RS19240 (KQ258_19235) tusA 3914751..3914996 (-) 246 WP_000130621.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 498 a.a.        Molecular weight: 54672.49 Da        Isoelectric Point: 4.1449

>NTDB_id=503713 KQ258_RS19210 WP_001040681.1 3908747..3910243(-) (pilA) [Escherichia coli strain S22EC]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIVQEQEPVKASEQAVEEQPQAHTEAEAETFAADVVEVTEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLPEDVNAEAVSPEEWQAEAETVEIVEAAEEEAAKEEITDEEPEAQAL
AAEVAEEAVMVVSPAEEDQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIAD
VGVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKTPFVILMVGVNGVGKTTTIGKLARQFEQ
QGKSVMLAAGDTFRAAAVEQLQVWGLRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKK
IVRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIED
LRPFKADDFIEALFARED

Nucleotide


Download         Length: 1497 bp        

>NTDB_id=503713 KQ258_RS19210 WP_001040681.1 3908747..3910243(-) (pilA) [Escherichia coli strain S22EC]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCAGTTGTAGAAGAAATCGTTCAGGAGCAAGAGCCTGTGAAGGCTTCTGAACAAGCCGTTGAAG
AGCAGCCGCAGGCGCATACTGAAGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTTACTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAACGTGAAGAACTGCCGTTGCCGGAAGACGTCAACGCCGAAGCGGTTTCGCCAGAAGAGTGGCAGGCCGAAGCGGAAA
CCGTAGAGATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATCACCGACGAAGAGCCGGAGGCACAGGCGCTG
GCTGCCGAAGTGGCAGAAGAGGCGGTAATGGTGGTTTCTCCGGCAGAAGAAGATCAGCCGGTGGAAGAAATCGCTCAGGA
GCAGGAAAAACCGACCAAAGAAGGTTTCTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAATCTCGGTTCCG
GATTTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAAGAGCTGGAAGAACAGCTGTTGATCGCCGAT
GTGGGCGTGGAAACCACTCGTAAAATTATCACCAATCTGACAGAAGGCGCATCCCGCAAGCAGCTTCGTGATGCCGAGGC
GCTCTATGGCCTGCTGAAAGAAGAGATGGGCGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGTAAAACGC
CGTTCGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCGCGTCAGTTTGAGCAG
CAGGGTAAATCGGTGATGCTGGCGGCAGGCGATACTTTCCGTGCGGCAGCGGTTGAACAGCTTCAGGTCTGGGGTCTGCG
CAACAATATTCCGGTGATTGCCCAGCATACCGGTGCGGATTCCGCTTCTGTTATCTTCGATGCCATTCAGGCCGCTAAAG
CGCGTAACATCGACGTCCTGATTGCCGATACCGCCGGACGCCTGCAAAACAAATCGCACCTGATGGAAGAGTTGAAGAAA
ATCGTCCGCGTGATGAAGAAACTCGACGTTGAAGCTCCGCATGAAGTTATGCTGACCATCGATGCCAGCACCGGGCAGAA
TGCGGTAAGCCAGGCCAAACTGTTCCACGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGA
AAGGCGGGGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGAT
TTGCGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.831

77.309

0.378