Detailed information
Overview
| Name | pilB | Type | Machinery gene |
| Locus tag | V6S37_RS01955 | Genome accession | NZ_CP145663 |
| Coordinates | 418155..419636 (-) | Length | 493 a.a. |
| NCBI ID | WP_001219894.1 | Uniprot ID | P45759 |
| Organism | Escherichia coli strain S1-INA-02-A | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 413155..424636
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| V6S37_RS01925 (V6S37_01930) | gspK | 414068..415051 (-) | 984 | WP_001058522.1 | type II secretion system minor pseudopilin GspK | - |
| V6S37_RS01930 (V6S37_01935) | gspJ | 415044..415631 (-) | 588 | WP_000610634.1 | type II secretion system minor pseudopilin GspJ | - |
| V6S37_RS01935 (V6S37_01940) | gspI | 415624..416001 (-) | 378 | WP_001041743.1 | type II secretion system minor pseudopilin GspI | - |
| V6S37_RS01940 (V6S37_01945) | gspH | 415998..416507 (-) | 510 | WP_001076046.1 | type II secretion system minor pseudopilin GspH | - |
| V6S37_RS01945 (V6S37_01950) | gspG | 416515..416952 (-) | 438 | WP_001202874.1 | type II secretion system major pseudopilin GspG | - |
| V6S37_RS01950 (V6S37_01955) | gspF | 416962..418158 (-) | 1197 | WP_001109573.1 | type II secretion system inner membrane protein GspF | - |
| V6S37_RS01955 (V6S37_01960) | pilB | 418155..419636 (-) | 1482 | WP_001219894.1 | type II secretion system ATPase GspE | Machinery gene |
| V6S37_RS01960 (V6S37_01965) | gspD | 419646..421598 (-) | 1953 | WP_001326512.1 | type II secretion system secretin GspD | - |
| V6S37_RS01965 (V6S37_01970) | gspC | 421582..422397 (-) | 816 | WP_192520810.1 | type II secretion system protein GspC | - |
| V6S37_RS01970 (V6S37_01975) | gspA | 422577..424046 (+) | 1470 | WP_000107576.1 | type II secretion system protein GspA | - |
| V6S37_RS01975 (V6S37_01980) | gspB | 424048..424467 (+) | 420 | WP_000461450.1 | putative general secretion pathway protein GspB | - |
Sequence
Protein
Download Length: 493 a.a. Molecular weight: 54610.56 Da Isoelectric Point: 6.2412
>NTDB_id=851827 V6S37_RS01955 WP_001219894.1 418155..419636(-) (pilB) [Escherichia coli strain S1-INA-02-A]
MRIHSPYPASWALAQRIGYLYSEGEIIYLADTPFERLLDIQRQVGQCQTMTSLSQADFEARLEAVFHQNTGESQQIAQDI
DQSVDLLSLSEEMPANEDLLNEDSAAPVIRLINAILSEAIKETASDIHIETYEKTMSIRFRIDGVLRTILQPNKKLAALL
ISRIKVMARLDIAEKRIPQDGRISLRIGRRNIDVRVSTLPSIYGERAVLRLLDKNSLQLSLNNLGMTAADKQDLENLIQL
PHGIILVTGPTGSGKSTTLYAILSALNTPGRNILTVEDPVEYELEGIGQTQVNTRVDMSFARGLRAILRQDPDVVMVGEI
RDTETAQIAVQASLTGHLVLSTLHTNSASGAVTRLRDMGVESFLLSSSLAGIIAQRLVRRLCPQCRQFTPVSPQQAQMFK
YHQLAVTTIGTPVGCPHCHQSGYQGRMAIHEMMVVTPELRAAIHENVDEQALERLVRQQHKALIKNGLQKVISGDTSWDE
VMRVASATLESEA
MRIHSPYPASWALAQRIGYLYSEGEIIYLADTPFERLLDIQRQVGQCQTMTSLSQADFEARLEAVFHQNTGESQQIAQDI
DQSVDLLSLSEEMPANEDLLNEDSAAPVIRLINAILSEAIKETASDIHIETYEKTMSIRFRIDGVLRTILQPNKKLAALL
ISRIKVMARLDIAEKRIPQDGRISLRIGRRNIDVRVSTLPSIYGERAVLRLLDKNSLQLSLNNLGMTAADKQDLENLIQL
PHGIILVTGPTGSGKSTTLYAILSALNTPGRNILTVEDPVEYELEGIGQTQVNTRVDMSFARGLRAILRQDPDVVMVGEI
RDTETAQIAVQASLTGHLVLSTLHTNSASGAVTRLRDMGVESFLLSSSLAGIIAQRLVRRLCPQCRQFTPVSPQQAQMFK
YHQLAVTTIGTPVGCPHCHQSGYQGRMAIHEMMVVTPELRAAIHENVDEQALERLVRQQHKALIKNGLQKVISGDTSWDE
VMRVASATLESEA
Nucleotide
Download Length: 1482 bp
>NTDB_id=851827 V6S37_RS01955 WP_001219894.1 418155..419636(-) (pilB) [Escherichia coli strain S1-INA-02-A]
ATGAGAATTCACTCACCGTACCCCGCCAGTTGGGCGCTGGCACAACGAATTGGTTATCTCTATTCAGAGGGCGAGATTAT
TTATCTCGCCGATACGCCATTCGAGCGGTTACTCGATATTCAACGTCAGGTTGGCCAGTGCCAGACCATGACCAGCTTGT
CACAGGCTGATTTTGAAGCTCGGCTGGAAGCGGTATTCCATCAGAATACCGGTGAGTCGCAACAGATTGCGCAGGATATC
GATCAATCCGTCGATCTTCTCTCGCTTTCGGAAGAGATGCCCGCAAATGAAGATCTCCTGAATGAAGATTCAGCGGCACC
GGTTATCCGCTTGATCAATGCGATTTTGAGTGAGGCCATCAAAGAAACCGCCTCTGATATCCACATTGAAACCTATGAAA
AAACAATGTCGATCCGTTTTCGCATCGACGGCGTTTTGCGGACAATTTTACAGCCAAACAAAAAACTGGCGGCACTGCTT
ATCTCCCGAATTAAGGTCATGGCTCGTCTTGATATCGCCGAAAAACGTATTCCACAGGATGGAAGAATTAGTTTGCGTAT
CGGGCGACGTAACATAGATGTCCGCGTATCCACACTGCCGTCCATCTATGGTGAACGCGCCGTACTCCGCCTGCTGGATA
AAAACAGCCTCCAGCTTTCATTGAACAACCTGGGGATGACGGCAGCGGATAAGCAGGATTTAGAAAATCTCATTCAGCTT
CCGCACGGTATTATCCTGGTGACAGGGCCGACAGGCTCCGGTAAAAGCACCACGCTCTACGCCATCCTTTCGGCGCTGAA
TACTCCCGGCCGCAATATTCTGACGGTAGAAGATCCCGTGGAATATGAGCTGGAAGGCATTGGGCAAACGCAGGTGAATA
CCCGTGTGGATATGTCTTTCGCTCGCGGCCTGCGCGCCATACTTCGCCAGGACCCGGATGTCGTCATGGTGGGGGAAATT
CGTGATACAGAAACCGCGCAGATTGCGGTTCAGGCCTCGCTCACCGGCCATCTGGTACTCTCAACACTCCACACTAACAG
TGCATCAGGCGCAGTGACCCGGCTCCGCGACATGGGCGTCGAATCATTCCTGCTTTCGTCTTCCCTGGCAGGGATTATCG
CGCAACGTCTGGTTCGTCGCCTGTGTCCGCAATGCCGACAATTCACGCCCGTATCACCCCAACAAGCGCAGATGTTTAAA
TATCATCAGCTCGCGGTGACAACAATTGGCACTCCCGTAGGCTGCCCTCATTGCCATCAATCCGGCTATCAGGGGCGCAT
GGCGATCCACGAAATGATGGTGGTGACGCCGGAATTACGGGCCGCTATTCATGAAAATGTGGATGAACAAGCACTGGAGC
GACTAGTCCGGCAACAACACAAGGCCTTAATCAAAAATGGCCTGCAAAAAGTGATAAGCGGTGACACCTCCTGGGATGAG
GTTATGCGCGTCGCCAGTGCCACGCTGGAGAGCGAAGCATGA
ATGAGAATTCACTCACCGTACCCCGCCAGTTGGGCGCTGGCACAACGAATTGGTTATCTCTATTCAGAGGGCGAGATTAT
TTATCTCGCCGATACGCCATTCGAGCGGTTACTCGATATTCAACGTCAGGTTGGCCAGTGCCAGACCATGACCAGCTTGT
CACAGGCTGATTTTGAAGCTCGGCTGGAAGCGGTATTCCATCAGAATACCGGTGAGTCGCAACAGATTGCGCAGGATATC
GATCAATCCGTCGATCTTCTCTCGCTTTCGGAAGAGATGCCCGCAAATGAAGATCTCCTGAATGAAGATTCAGCGGCACC
GGTTATCCGCTTGATCAATGCGATTTTGAGTGAGGCCATCAAAGAAACCGCCTCTGATATCCACATTGAAACCTATGAAA
AAACAATGTCGATCCGTTTTCGCATCGACGGCGTTTTGCGGACAATTTTACAGCCAAACAAAAAACTGGCGGCACTGCTT
ATCTCCCGAATTAAGGTCATGGCTCGTCTTGATATCGCCGAAAAACGTATTCCACAGGATGGAAGAATTAGTTTGCGTAT
CGGGCGACGTAACATAGATGTCCGCGTATCCACACTGCCGTCCATCTATGGTGAACGCGCCGTACTCCGCCTGCTGGATA
AAAACAGCCTCCAGCTTTCATTGAACAACCTGGGGATGACGGCAGCGGATAAGCAGGATTTAGAAAATCTCATTCAGCTT
CCGCACGGTATTATCCTGGTGACAGGGCCGACAGGCTCCGGTAAAAGCACCACGCTCTACGCCATCCTTTCGGCGCTGAA
TACTCCCGGCCGCAATATTCTGACGGTAGAAGATCCCGTGGAATATGAGCTGGAAGGCATTGGGCAAACGCAGGTGAATA
CCCGTGTGGATATGTCTTTCGCTCGCGGCCTGCGCGCCATACTTCGCCAGGACCCGGATGTCGTCATGGTGGGGGAAATT
CGTGATACAGAAACCGCGCAGATTGCGGTTCAGGCCTCGCTCACCGGCCATCTGGTACTCTCAACACTCCACACTAACAG
TGCATCAGGCGCAGTGACCCGGCTCCGCGACATGGGCGTCGAATCATTCCTGCTTTCGTCTTCCCTGGCAGGGATTATCG
CGCAACGTCTGGTTCGTCGCCTGTGTCCGCAATGCCGACAATTCACGCCCGTATCACCCCAACAAGCGCAGATGTTTAAA
TATCATCAGCTCGCGGTGACAACAATTGGCACTCCCGTAGGCTGCCCTCATTGCCATCAATCCGGCTATCAGGGGCGCAT
GGCGATCCACGAAATGATGGTGGTGACGCCGGAATTACGGGCCGCTATTCATGAAAATGTGGATGAACAAGCACTGGAGC
GACTAGTCCGGCAACAACACAAGGCCTTAATCAAAAATGGCCTGCAAAAAGTGATAAGCGGTGACACCTCCTGGGATGAG
GTTATGCGCGTCGCCAGTGCCACGCTGGAGAGCGAAGCATGA
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| pilB | Vibrio campbellii strain DS40M4 |
46.682 |
88.641 |
0.414 |
| pilB | Vibrio cholerae strain A1552 |
48.441 |
84.584 |
0.41 |
| pilB | Acinetobacter baumannii D1279779 |
45.578 |
89.452 |
0.408 |
| pilB | Legionella pneumophila strain ERS1305867 |
41.372 |
97.566 |
0.404 |
| pilB | Vibrio parahaemolyticus RIMD 2210633 |
46.353 |
86.207 |
0.4 |
| pilB/pilB1 | Synechocystis sp. PCC 6803 |
41.176 |
96.552 |
0.398 |
| pilB | Acinetobacter baylyi ADP1 |
48.338 |
79.31 |
0.383 |
| pilF | Thermus thermophilus HB27 |
45.316 |
80.122 |
0.363 |
| pilB | Deinococcus radiodurans R1 = ATCC 13939 = DSM 20539 |
45.178 |
79.919 |
0.361 |