Detailed information
Overview
| Name | pilB | Type | Machinery gene |
| Locus tag | V6S40_RS10135 | Genome accession | NZ_CP145657 |
| Coordinates | 2040284..2041777 (-) | Length | 497 a.a. |
| NCBI ID | WP_000249368.1 | Uniprot ID | - |
| Organism | Escherichia coli strain S1-IND-01-A | ||
| Function | assembly of type IV pilus (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 2035284..2046777
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| V6S40_RS10105 (V6S40_10110) | gspK | 2036078..2037055 (-) | 978 | WP_000633239.1 | type II secretion system minor pseudopilin GspK | - |
| V6S40_RS10110 (V6S40_10115) | gspJ | 2037052..2037657 (-) | 606 | WP_001255030.1 | type II secretion system minor pseudopilin GspJ | - |
| V6S40_RS10115 (V6S40_10120) | gspI | 2037654..2038025 (-) | 372 | WP_000820125.1 | type II secretion system minor pseudopilin GspI | - |
| V6S40_RS10120 (V6S40_10125) | gspH | 2038022..2038585 (-) | 564 | WP_001115139.1 | type II secretion system minor pseudopilin GspH | - |
| V6S40_RS10125 (V6S40_10130) | gspG | 2038589..2039044 (-) | 456 | WP_001087296.1 | type II secretion system major pseudopilin GspG | - |
| V6S40_RS10130 (V6S40_10135) | gspF | 2039061..2040284 (-) | 1224 | WP_001173448.1 | type II secretion system inner membrane protein GspF | - |
| V6S40_RS10135 (V6S40_10140) | pilB | 2040284..2041777 (-) | 1494 | WP_000249368.1 | type II secretion system ATPase GspE | Machinery gene |
| V6S40_RS10140 (V6S40_10145) | gspD | 2041777..2043837 (-) | 2061 | WP_000498824.1 | type II secretion system secretin GspD | - |
| V6S40_RS10145 (V6S40_10150) | gspC | 2043867..2044826 (-) | 960 | WP_001317325.1 | type II secretion system protein GspC | - |
| V6S40_RS10150 (V6S40_10155) | gspS2 | 2044844..2045254 (-) | 411 | WP_001349452.1 | type II secretion system pilot lipoprotein GspS-beta | - |
| V6S40_RS10155 (V6S40_10160) | pilD | 2045320..2046129 (-) | 810 | WP_001317326.1 | prepilin peptidase PppA | Machinery gene |
Sequence
Protein
Download Length: 497 a.a. Molecular weight: 55132.29 Da Isoelectric Point: 6.1631
>NTDB_id=851685 V6S40_RS10135 WP_000249368.1 2040284..2041777(-) (pilB) [Escherichia coli strain S1-IND-01-A]
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNAPFTLRQIDGAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSQQLT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQPAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA
MVPVAQETTANTVRLPYSFSRRFSLVAWCEASLEILHVHPLSLSVLQELQRGLNAPFTLRQIDGAEFEQRLNAVWQRDSS
EARQLMEDLGSAEDFFTLAEELPETEDLLESDDDAPIIKLINAMLAEAIKEGASDIHIETFEKSLVIRFRVDGTLHEMLR
PGRKLASLLVSRIKVMARLDIAEKRVPQDGRIALLLGGRAIDVRVSTMPSAWGERVVLRLLDKNQARLTLERLGLSQQLT
AQLRQLLHKPHGIFLVTGPTGSGKSTTLYAGLQELNNHSRNILTVEDPIEYMIEGIGQTQVNTRVGMTFARGLRAILRQD
PDVVMVGEIRDTETAEIAVQASLTGHLVLSTLHTNTAVGAITRLQDMGVEPFLLSSSLTGVMAQRLVRTLCPDCRQPAPA
TDEEKRLLGITDARTVTLYHPQGCPACNHKGFRGRTAIHELIVVDATLRDLIHRQAGELELERYVRQHSAGIRSNGIEKV
LAGETSLDEVLRVTMEA
Nucleotide
Download Length: 1494 bp
>NTDB_id=851685 V6S40_RS10135 WP_000249368.1 2040284..2041777(-) (pilB) [Escherichia coli strain S1-IND-01-A]
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTGCATCCGTTGTCGCTCTCTGTTTTGCAGGAGCTGCAGCGGGGGCTGA
ACGCGCCCTTTACGCTGCGGCAAATCGACGGGGCCGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAGGCTCGCCAGCTGATGGAAGATCTCGGTTCTGCTGAGGACTTTTTTACTCTCGCGGAAGAACTGCCAGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCGATTAAAGAAGGCGCTT
CGGATATCCACATCGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGCGTTGACGGCACATTACATGAAATGCTGCGC
CCGGGGCGCAAACTGGCCTCGCTGCTGGTGTCGCGTATCAAGGTGATGGCGCGGCTGGACATTGCCGAAAAGCGCGTGCC
GCAGGATGGACGTATTGCGCTGTTGCTGGGCGGCCGGGCGATTGACGTGCGTGTCTCCACCATGCCTTCTGCCTGGGGCG
AGCGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCCCGCCTGACGCTGGAGCGTCTGGGGCTTAGCCAGCAACTGACC
GCGCAGTTGCGCCAGCTGTTACACAAACCGCACGGCATCTTTCTGGTGACGGGGCCGACGGGTTCCGGCAAAAGCACCAC
GCTGTACGCCGGATTGCAGGAGCTGAACAACCATTCGCGCAACATTCTCACGGTTGAAGATCCCATCGAATACATGATTG
AAGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACCTTTGCCCGTGGGCTGCGCGCGATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATTCGCGATACCGAAACCGCAGAAATCGCCGTCCAGGCTTCACTTACCGGACACCT
GGTCCTTTCCACGCTGCATACCAACACAGCGGTGGGGGCGATCACACGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGCGTGATGGCGCAGCGACTGGTTCGCACGCTGTGTCCCGACTGCCGCCAGCCCGCACCAGCC
ACTGACGAAGAAAAACGCCTGCTGGGAATTACCGACGCCCGTACCGTCACTCTGTACCATCCACAGGGCTGTCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGGACTGCCATCCATGAGCTGATCGTGGTGGATGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAGCTGGAGCTGGAACGTTATGTCCGACAACACTCTGCGGGTATCCGCAGCAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA
ATGGTGCCTGTAGCACAGGAAACCACCGCTAACACCGTGCGTCTGCCCTACAGTTTCAGCCGTCGGTTTAGCCTGGTGGC
ATGGTGCGAAGCGTCGCTGGAGATCCTCCATGTGCATCCGTTGTCGCTCTCTGTTTTGCAGGAGCTGCAGCGGGGGCTGA
ACGCGCCCTTTACGCTGCGGCAAATCGACGGGGCCGAATTTGAACAGCGGCTGAATGCGGTCTGGCAGCGGGACTCTTCC
GAGGCTCGCCAGCTGATGGAAGATCTCGGTTCTGCTGAGGACTTTTTTACTCTCGCGGAAGAACTGCCAGAAACGGAAGA
TCTGCTGGAAAGTGACGACGATGCGCCGATCATCAAACTGATCAACGCCATGCTGGCAGAGGCGATTAAAGAAGGCGCTT
CGGATATCCACATCGAGACGTTTGAAAAGAGTCTGGTGATCCGTTTTCGCGTTGACGGCACATTACATGAAATGCTGCGC
CCGGGGCGCAAACTGGCCTCGCTGCTGGTGTCGCGTATCAAGGTGATGGCGCGGCTGGACATTGCCGAAAAGCGCGTGCC
GCAGGATGGACGTATTGCGCTGTTGCTGGGCGGCCGGGCGATTGACGTGCGTGTCTCCACCATGCCTTCTGCCTGGGGCG
AGCGCGTGGTGCTGCGACTGCTGGACAAAAACCAGGCCCGCCTGACGCTGGAGCGTCTGGGGCTTAGCCAGCAACTGACC
GCGCAGTTGCGCCAGCTGTTACACAAACCGCACGGCATCTTTCTGGTGACGGGGCCGACGGGTTCCGGCAAAAGCACCAC
GCTGTACGCCGGATTGCAGGAGCTGAACAACCATTCGCGCAACATTCTCACGGTTGAAGATCCCATCGAATACATGATTG
AAGGGATCGGTCAGACGCAGGTTAACACCCGCGTCGGCATGACCTTTGCCCGTGGGCTGCGCGCGATTTTGCGTCAGGAC
CCGGATGTGGTGATGGTCGGTGAAATTCGCGATACCGAAACCGCAGAAATCGCCGTCCAGGCTTCACTTACCGGACACCT
GGTCCTTTCCACGCTGCATACCAACACAGCGGTGGGGGCGATCACACGTTTGCAGGATATGGGCGTGGAGCCTTTCCTGC
TCTCTTCCAGTCTGACGGGCGTGATGGCGCAGCGACTGGTTCGCACGCTGTGTCCCGACTGCCGCCAGCCCGCACCAGCC
ACTGACGAAGAAAAACGCCTGCTGGGAATTACCGACGCCCGTACCGTCACTCTGTACCATCCACAGGGCTGTCCCGCCTG
TAATCACAAAGGTTTTCGCGGACGGACTGCCATCCATGAGCTGATCGTGGTGGATGCCACATTGCGTGATTTGATCCACC
GTCAGGCCGGGGAGCTGGAGCTGGAACGTTATGTCCGACAACACTCTGCGGGTATCCGCAGCAACGGCATTGAGAAAGTG
CTCGCCGGAGAAACCTCTCTCGATGAAGTTCTGCGGGTAACCATGGAGGCGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| pilB | Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539 |
44.332 |
99.396 |
0.441 |
| pilB/pilB1 | Synechocystis sp. PCC 6803 |
39.372 |
100 |
0.429 |
| pilB | Vibrio parahaemolyticus RIMD 2210633 |
48.615 |
79.879 |
0.388 |
| pilB | Vibrio campbellii strain DS40M4 |
47.475 |
79.678 |
0.378 |
| pilB | Legionella pneumophila strain ERS1305867 |
43.619 |
86.72 |
0.378 |
| pilB | Acinetobacter baumannii D1279779 |
46.617 |
80.282 |
0.374 |
| pilB | Vibrio cholerae strain A1552 |
46.212 |
79.678 |
0.368 |
| pilF | Thermus thermophilus HB27 |
45 |
80.483 |
0.362 |