Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   K8B92_RS21890 Genome accession   NZ_CP082776
Coordinates   4519968..4521464 (-) Length   498 a.a.
NCBI ID   WP_001040640.1    Uniprot ID   -
Organism   Escherichia coli O4:H5 strain CU532-9     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 4514968..4526464
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  K8B92_RS21865 (K8B92_21760) - 4515239..4516159 (+) 921 WP_001332164.1 phosphoglycerate dehydrogenase -
  K8B92_RS21870 (K8B92_21765) dapA 4516159..4517043 (+) 885 WP_000661262.1 4-hydroxy-tetrahydrodipicolinate synthase -
  K8B92_RS21875 (K8B92_21770) rpoH 4517147..4518001 (-) 855 WP_000130217.1 RNA polymerase sigma factor RpoH -
  K8B92_RS21880 (K8B92_21775) ftsX 4518246..4519304 (-) 1059 WP_001042003.1 permease-like cell division protein FtsX -
  K8B92_RS21885 (K8B92_21780) ftsE 4519297..4519965 (-) 669 WP_042050926.1 cell division ATP-binding protein FtsE -
  K8B92_RS21890 (K8B92_21785) pilA 4519968..4521464 (-) 1497 WP_001040640.1 signal recognition particle-docking protein FtsY Machinery gene
  K8B92_RS21895 (K8B92_21790) rsmD 4521614..4522210 (+) 597 WP_000743189.1 16S rRNA (guanine(966)-N(2))-methyltransferase -
  K8B92_RS21900 (K8B92_21795) yhhL 4522200..4522469 (+) 270 WP_001295207.1 DUF1145 family protein -
  K8B92_RS21905 (K8B92_21800) yhhM 4522472..4522831 (-) 360 WP_000042886.1 DUF2500 domain-containing protein -
  K8B92_RS21910 (K8B92_21805) yhhN 4522972..4523598 (+) 627 WP_000964718.1 lysoplasmalogenase -
  K8B92_RS21915 (K8B92_21810) zntA 4523672..4525870 (+) 2199 WP_001468058.1 Zn(II)/Cd(II)/Pb(II) translocating P-type ATPase ZntA -
  K8B92_RS21920 (K8B92_21815) tusA 4525972..4526217 (-) 246 WP_000130621.1 sulfurtransferase TusA -

Sequence


Protein


Download         Length: 498 a.a.        Molecular weight: 54600.34 Da        Isoelectric Point: 4.1714

>NTDB_id=528987 K8B92_RS21890 WP_001040640.1 4519968..4521464(-) (pilA) [Escherichia coli O4:H5 strain CU532-9]
MAKEKKRGFFSWLGFGQKEQTPEKETEVQNEQPVVEEIVQAQEPVKASEHAVEEQPQAHTEAEAETFAADVVEVTEQVAE
SEKAQPEAEVVAQPEPVVEETPEPVAIEREELPLSEDVNAEAVSPEEWQAEAETVDIVEAAEEEAAKEEITDEEPEAQAL
AAEAAEEAVMVVSPAEEEQPVEEIAQEQEKPTKEGFFARLKRSLLKTKENLGSGFISLFRGKKIDDDLFEELEEQLLIAD
VGVETTRKIITNLTEGASRKQLRDAEALYGLLKEEMGEILAKVDEPLNVEGKTPFVILMVGVNGVGKTTTIGKLARQFEQ
QGKSVMLAAGDTFRAAAVEQLQVWGQRNNIPVIAQHTGADSASVIFDAIQAAKARNIDVLIADTAGRLQNKSHLMEELKK
IVRVMKKLDVEAPHEVMLTIDASTGQNAVSQAKLFHEAVGLTGITLTKLDGTAKGGVIFSVADQFGIPIRYIGVGERIED
LRPFKADDFIEALFARED

Nucleotide


Download         Length: 1497 bp        

>NTDB_id=528987 K8B92_RS21890 WP_001040640.1 4519968..4521464(-) (pilA) [Escherichia coli O4:H5 strain CU532-9]
ATGGCGAAAGAAAAAAAACGTGGCTTTTTTTCCTGGCTGGGCTTTGGTCAAAAAGAGCAGACCCCGGAAAAAGAGACAGA
AGTTCAGAATGAACAACCAGTTGTAGAAGAAATCGTTCAGGCGCAAGAGCCTGTGAAGGCTTCTGAACACGCCGTTGAAG
AGCAGCCGCAGGCGCATACTGAAGCCGAGGCGGAAACTTTTGCTGCCGACGTTGTGGAAGTTACTGAACAGGTTGCTGAA
AGTGAAAAAGCGCAGCCTGAAGCGGAAGTCGTTGCACAGCCGGAACCGGTCGTAGAAGAAACGCCGGAGCCAGTGGCTAT
CGAACGTGAAGAACTGCCGTTGTCGGAAGACGTCAACGCCGAAGCGGTTTCGCCAGAAGAGTGGCAGGCCGAAGCGGAAA
CCGTAGATATTGTCGAAGCGGCGGAAGAAGAAGCGGCTAAAGAAGAAATCACCGACGAAGAGCCGGAGGCACAGGCGCTG
GCTGCCGAAGCGGCAGAAGAGGCGGTAATGGTGGTTTCTCCGGCAGAAGAAGAGCAGCCGGTGGAAGAAATCGCTCAGGA
GCAGGAAAAACCGACCAAAGAAGGTTTCTTCGCGCGCCTGAAACGCAGCCTGTTAAAAACCAAAGAAAATCTCGGTTCCG
GATTTATCAGCCTGTTCCGCGGTAAAAAAATCGACGATGATCTGTTTGAAGAGCTGGAAGAACAGCTGTTGATCGCCGAT
GTGGGCGTGGAAACCACTCGTAAAATTATCACCAATCTGACGGAAGGCGCATCCCGCAAGCAGCTTCGTGATGCCGAGGC
GCTCTATGGCCTGCTGAAAGAAGAGATGGGCGAGATTCTGGCGAAAGTCGATGAGCCGCTGAATGTTGAAGGTAAAACGC
CGTTCGTGATCCTGATGGTGGGCGTCAACGGTGTGGGTAAAACCACGACGATTGGTAAGCTGGCGCGTCAGTTTGAGCAG
CAGGGTAAATCGGTGATGCTGGCGGCAGGCGATACTTTCCGTGCGGCAGCGGTTGAACAGCTTCAGGTCTGGGGTCAGCG
CAACAATATTCCGGTGATTGCCCAGCATACCGGTGCGGATTCCGCTTCTGTTATCTTCGATGCCATTCAGGCCGCTAAAG
CGCGTAACATCGACGTCCTGATTGCCGATACCGCCGGACGCCTGCAAAACAAATCGCACCTGATGGAAGAGTTGAAGAAA
ATCGTCCGCGTGATGAAGAAACTCGACGTTGAAGCTCCGCATGAAGTTATGCTGACCATCGATGCCAGCACCGGGCAGAA
TGCGGTAAGCCAGGCCAAACTGTTCCACGAAGCCGTTGGCTTAACCGGCATCACGCTAACGAAACTGGACGGCACGGCGA
AAGGCGGGGTAATTTTCTCGGTGGCTGACCAGTTTGGTATCCCTATCCGCTACATTGGTGTCGGCGAACGTATTGAGGAT
TTGCGTCCGTTTAAGGCGGACGACTTTATAGAGGCACTTTTTGCCCGAGAGGATTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

48.571

77.309

0.375