Detailed information    

insolico Bioinformatically predicted

Overview


Name   pilA   Type   Machinery gene
Locus tag   K9N54_RS16470 Genome accession   NZ_CP083361
Coordinates   3426197..3427432 (-) Length   411 a.a.
NCBI ID   WP_159357226.1    Uniprot ID   -
Organism   Vibrio parahaemolyticus strain 20-082E4     
Function   assembly of type IV pilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 3421197..3432432
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  K9N54_RS16440 (K9N54_16325) - 3421382..3421792 (+) 411 WP_005460376.1 flagellar basal body-associated protein FliL -
  K9N54_RS16445 (K9N54_16330) glpG 3421852..3422694 (-) 843 WP_025510242.1 rhomboid family intramembrane serine protease GlpG -
  K9N54_RS16450 (K9N54_16335) glpE 3422694..3423014 (-) 321 WP_005460380.1 thiosulfate sulfurtransferase GlpE -
  K9N54_RS16455 (K9N54_16340) rpoH 3423506..3424366 (-) 861 WP_005490420.1 RNA polymerase sigma factor RpoH -
  K9N54_RS16460 (K9N54_16345) ftsX 3424542..3425510 (-) 969 WP_005481956.1 permease-like cell division protein FtsX -
  K9N54_RS16465 (K9N54_16350) ftsE 3425500..3426174 (-) 675 WP_005481953.1 cell division ATP-binding protein FtsE -
  K9N54_RS16470 (K9N54_16355) pilA 3426197..3427432 (-) 1236 WP_159357226.1 signal recognition particle-docking protein FtsY Machinery gene
  K9N54_RS16475 (K9N54_16360) rsmD 3427656..3428255 (+) 600 WP_005455148.1 16S rRNA (guanine(966)-N(2))-methyltransferase RsmD -
  K9N54_RS16480 (K9N54_16365) - 3428281..3428547 (+) 267 WP_005496405.1 DUF1145 domain-containing protein -
  K9N54_RS16485 (K9N54_16370) - 3428601..3429185 (-) 585 WP_005455144.1 YhgN family NAAT transporter -
  K9N54_RS16490 (K9N54_16375) - 3429305..3429526 (-) 222 WP_015297472.1 YecH family metal-binding protein -
  K9N54_RS16495 (K9N54_16380) - 3429596..3430216 (-) 621 WP_005481960.1 lysoplasmalogenase -
  K9N54_RS16500 (K9N54_16385) - 3430950..3431129 (+) 180 WP_033905002.1 hypothetical protein -
  K9N54_RS16505 (K9N54_16390) - 3431192..3431560 (-) 369 WP_005489749.1 hypothetical protein -
  K9N54_RS16510 (K9N54_16395) - 3431802..3432131 (+) 330 WP_015297474.1 DUF2500 domain-containing protein -

Sequence


Protein


Download         Length: 411 a.a.        Molecular weight: 44683.26 Da        Isoelectric Point: 4.2583

>NTDB_id=531773 K9N54_RS16470 WP_159357226.1 3426197..3427432(-) (pilA) [Vibrio parahaemolyticus strain 20-082E4]
MTEKKKRGLLSWLGFGDEEQSPKPKTEETVTEEAVEAPSEEQQTEEVAEQAQQTQELEQEPEKAETAPAEAEAEAEAEAE
AEAEAEAEGPQVPVAPRIQEQEKPTESFFARLKRSLSRTKANIGAGFFGLFSGKKIDDDLFEELEEQLLIADVGMDTTTK
IINNLTEKASRGDLKDGEALYGLLKEEMAEILSKVEQPLEIDSSKTPYVILMVGVNGVGKTTTIGKLAKQFQSQGKKVML
AAGDTFRAAAVEQLQVWGERNNVPVIAQHTGADSASVIYDAIEAAKARGVDVVIADTAGRLQNKANLMEELRKIVRVMKK
IDDSAPHEIMLTLDAGTGQNAISQAKLFSDVAPLTGITLTKLDGTAKGGVIFAIADQFGIPIRYIGVGEGIEDLRPFETQ
EFIDALFSREE

Nucleotide


Download         Length: 1236 bp        

>NTDB_id=531773 K9N54_RS16470 WP_159357226.1 3426197..3427432(-) (pilA) [Vibrio parahaemolyticus strain 20-082E4]
ATGACGGAAAAAAAGAAGCGCGGATTACTTTCGTGGCTAGGTTTTGGTGACGAAGAACAAAGCCCAAAACCAAAAACTGA
AGAAACAGTAACAGAAGAAGCAGTGGAAGCGCCTTCTGAAGAACAGCAAACCGAAGAGGTTGCTGAGCAAGCGCAACAAA
CTCAAGAGCTTGAACAAGAGCCAGAAAAAGCTGAGACTGCCCCAGCAGAAGCAGAAGCAGAAGCAGAAGCAGAAGCAGAA
GCAGAAGCAGAAGCAGAAGCAGAAGGGCCACAAGTACCGGTTGCGCCTCGTATTCAAGAGCAAGAAAAGCCGACAGAAAG
CTTCTTCGCTCGCCTTAAACGCAGCCTTAGCCGTACGAAAGCAAACATCGGTGCTGGTTTCTTTGGTCTGTTCAGCGGTA
AAAAAATCGATGACGACCTATTTGAAGAGCTAGAAGAGCAACTGCTCATTGCCGATGTGGGCATGGACACCACCACAAAA
ATCATCAACAACCTGACAGAAAAAGCCTCTCGTGGTGATCTGAAAGATGGCGAAGCCCTTTATGGCCTGCTGAAAGAAGA
AATGGCGGAGATTTTATCTAAAGTAGAACAGCCTCTAGAGATCGACAGCAGCAAAACACCTTACGTCATCTTGATGGTTG
GTGTGAATGGTGTGGGTAAAACCACCACCATCGGTAAACTTGCGAAGCAGTTCCAAAGCCAAGGCAAGAAAGTGATGTTA
GCGGCTGGCGATACTTTCCGAGCGGCTGCAGTTGAGCAGCTGCAAGTGTGGGGCGAACGTAACAATGTTCCTGTGATCGC
GCAGCATACTGGCGCAGACAGCGCATCGGTTATCTACGATGCGATTGAAGCGGCAAAAGCGCGTGGCGTCGATGTGGTTA
TCGCCGATACGGCGGGTCGTCTACAAAACAAAGCCAACCTAATGGAAGAGCTACGCAAGATTGTGCGTGTGATGAAGAAA
ATTGATGATTCTGCACCACATGAAATCATGCTGACGCTGGATGCAGGTACTGGCCAAAATGCGATTAGCCAAGCGAAACT
TTTCAGTGATGTAGCTCCTCTAACCGGGATTACATTGACTAAGCTGGATGGTACAGCGAAAGGCGGCGTTATTTTCGCTA
TCGCTGATCAGTTTGGTATTCCAATTCGCTACATTGGTGTTGGCGAAGGCATTGAAGACTTGCGTCCTTTTGAAACTCAA
GAGTTTATCGACGCTTTGTTTAGCCGTGAAGAGTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  pilA Neisseria gonorrhoeae MS11

50.562

86.618

0.438