Detailed information
Overview
| Name | pilC | Type | Machinery gene |
| Locus tag | DQL18_RS04020 | Genome accession | NZ_LS483486 |
| Coordinates | 763848..765068 (+) | Length | 406 a.a. |
| NCBI ID | WP_042601844.1 | Uniprot ID | - |
| Organism | Haemophilus influenzae strain NCTC12194 | ||
| Function | type IV pilus biogenesis and function (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 758848..770068
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| DQL18_RS04000 (NCTC12194_00808) | corC | 759815..760714 (-) | 900 | WP_005656283.1 | CNNM family magnesium/cobalt transport protein CorC | - |
| DQL18_RS04005 (NCTC12194_00809) | ampD | 761336..761896 (-) | 561 | WP_011271974.1 | 1,6-anhydro-N-acetylmuramyl-L-alanine amidase AmpD | - |
| DQL18_RS04010 (NCTC12194_00810) | pilA | 762011..762460 (+) | 450 | WP_011271973.1 | prepilin-type N-terminal cleavage/methylation domain-containing protein | Machinery gene |
| DQL18_RS04015 (NCTC12194_00811) | pilB | 762457..763851 (+) | 1395 | WP_105905461.1 | GspE/PulE family protein | Machinery gene |
| DQL18_RS04020 (NCTC12194_00812) | pilC | 763848..765068 (+) | 1221 | WP_042601844.1 | type II secretion system F family protein | Machinery gene |
| DQL18_RS04025 (NCTC12194_00813) | pilD | 765065..765757 (+) | 693 | WP_105905460.1 | prepilin peptidase | Machinery gene |
| DQL18_RS04030 (NCTC12194_00814) | rho | 765811..767073 (-) | 1263 | WP_005648966.1 | transcription termination factor Rho | - |
| DQL18_RS04035 (NCTC12194_00815) | metJ | 767321..767638 (+) | 318 | WP_005631186.1 | met regulon transcriptional regulator MetJ | - |
| DQL18_RS04040 (NCTC12194_00816) | cueR | 767652..768038 (-) | 387 | WP_005648963.1 | Cu(I)-responsive transcriptional regulator | - |
| DQL18_RS04045 (NCTC12194_00817) | - | 768115..768321 (+) | 207 | WP_048941374.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04050 (NCTC12194_00818) | - | 768395..768601 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04055 (NCTC12194_00819) | - | 768675..768881 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04060 (NCTC12194_00820) | - | 768955..769161 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04065 (NCTC12194_00821) | - | 769235..769441 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04070 (NCTC12194_00822) | - | 769515..769721 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
| DQL18_RS04075 (NCTC12194_00823) | - | 769807..770013 (+) | 207 | WP_005666693.1 | heavy-metal-associated domain-containing protein | - |
Sequence
Protein
Download Length: 406 a.a. Molecular weight: 46205.41 Da Isoelectric Point: 9.7152
>NTDB_id=1025941 DQL18_RS04020 WP_042601844.1 763848..765068(+) (pilC) [Haemophilus influenzae strain NCTC12194]
MTKKLFYYQGSNALNQKQKGSIIADTKQQAHFQLISRGLTHIKLQQNWQFGAKPKNSEISELLNQLATLLQSVIPLKNSL
QILQQDCTQIMLNEWLERLLQSIESGLAFSQAIEQQGKYLTQQEIQLIQVGEMTGKLAVVCKKIATHRSQSLALQRKLQK
IMLYPSMVLGISLLLTLALLLFIVPQFAEMYSGNNAELPTITAILLSISNFLKQNIGILLFFALSFVLFYYFYLKRQTWF
HQKKNQLISITPIFGTIQKLSRLVNFSHSLQIMLQAGVPLNQALDSFLPRTQTWQTKKTLVNDIVLDKEVRSILQWVSQG
YAFSDSVSSDLFPMEAQQMLQIGEQSGKLALMLEHIADNYQEKLNHQIDLLSQMLEPLMMVIIGSLIGIIMMGMYLPIFN
MGSVIQ
MTKKLFYYQGSNALNQKQKGSIIADTKQQAHFQLISRGLTHIKLQQNWQFGAKPKNSEISELLNQLATLLQSVIPLKNSL
QILQQDCTQIMLNEWLERLLQSIESGLAFSQAIEQQGKYLTQQEIQLIQVGEMTGKLAVVCKKIATHRSQSLALQRKLQK
IMLYPSMVLGISLLLTLALLLFIVPQFAEMYSGNNAELPTITAILLSISNFLKQNIGILLFFALSFVLFYYFYLKRQTWF
HQKKNQLISITPIFGTIQKLSRLVNFSHSLQIMLQAGVPLNQALDSFLPRTQTWQTKKTLVNDIVLDKEVRSILQWVSQG
YAFSDSVSSDLFPMEAQQMLQIGEQSGKLALMLEHIADNYQEKLNHQIDLLSQMLEPLMMVIIGSLIGIIMMGMYLPIFN
MGSVIQ
Nucleotide
Download Length: 1221 bp
>NTDB_id=1025941 DQL18_RS04020 WP_042601844.1 763848..765068(+) (pilC) [Haemophilus influenzae strain NCTC12194]
ATGACTAAAAAACTCTTTTATTATCAAGGTAGTAACGCATTAAATCAGAAACAAAAAGGCTCAATTATTGCGGATACGAA
ACAACAAGCACACTTTCAGTTAATAAGCCGCGGGCTTACTCACATCAAATTACAACAAAACTGGCAATTTGGGGCAAAGC
CCAAAAATTCAGAAATCAGTGAATTACTCAATCAATTAGCGACATTGCTACAGTCCGTAATTCCGTTAAAAAACAGCCTG
CAAATTTTGCAACAAGATTGTACTCAAATTATGCTCAACGAATGGCTTGAACGACTGCTTCAATCCATTGAATCTGGCTT
AGCATTCTCACAAGCAATTGAACAACAAGGAAAATATCTCACACAACAAGAAATTCAACTGATTCAAGTGGGAGAAATGA
CAGGAAAACTTGCCGTAGTTTGTAAAAAAATAGCCACGCACCGTAGTCAATCTTTGGCTTTACAACGCAAATTACAGAAA
ATTATGTTATATCCCTCAATGGTATTGGGAATTTCTCTATTATTGACACTCGCATTACTGCTTTTTATCGTGCCTCAATT
TGCTGAAATGTACAGTGGCAACAATGCCGAATTACCAACAATAACTGCAATATTGCTCTCTATATCCAATTTTCTTAAGC
AAAATATTGGCATTTTGCTATTTTTCGCTTTGAGTTTTGTTCTATTTTATTACTTTTATCTAAAACGCCAGACTTGGTTT
CATCAAAAGAAAAATCAACTTATTTCTATCACGCCTATTTTTGGCACAATTCAAAAACTTTCACGTTTAGTGAACTTTAG
TCACAGTTTACAAATTATGTTACAGGCTGGCGTACCGCTTAATCAAGCACTAGACAGTTTTCTCCCTCGCACACAAACGT
GGCAAACCAAGAAAACGCTTGTAAATGACATCGTATTAGATAAAGAAGTGCGGTCAATTTTACAATGGGTTTCTCAAGGC
TATGCGTTTTCTGATAGTGTAAGTAGCGATCTTTTCCCGATGGAAGCACAACAAATGCTCCAAATTGGCGAACAAAGCGG
AAAACTCGCTTTGATGCTAGAGCATATCGCGGATAATTACCAAGAAAAACTTAATCATCAAATTGACTTACTCTCACAAA
TGCTAGAACCATTAATGATGGTAATTATCGGCAGTCTGATTGGAATTATTATGATGGGAATGTATTTACCTATCTTTAAT
ATGGGCTCTGTTATTCAATGA
ATGACTAAAAAACTCTTTTATTATCAAGGTAGTAACGCATTAAATCAGAAACAAAAAGGCTCAATTATTGCGGATACGAA
ACAACAAGCACACTTTCAGTTAATAAGCCGCGGGCTTACTCACATCAAATTACAACAAAACTGGCAATTTGGGGCAAAGC
CCAAAAATTCAGAAATCAGTGAATTACTCAATCAATTAGCGACATTGCTACAGTCCGTAATTCCGTTAAAAAACAGCCTG
CAAATTTTGCAACAAGATTGTACTCAAATTATGCTCAACGAATGGCTTGAACGACTGCTTCAATCCATTGAATCTGGCTT
AGCATTCTCACAAGCAATTGAACAACAAGGAAAATATCTCACACAACAAGAAATTCAACTGATTCAAGTGGGAGAAATGA
CAGGAAAACTTGCCGTAGTTTGTAAAAAAATAGCCACGCACCGTAGTCAATCTTTGGCTTTACAACGCAAATTACAGAAA
ATTATGTTATATCCCTCAATGGTATTGGGAATTTCTCTATTATTGACACTCGCATTACTGCTTTTTATCGTGCCTCAATT
TGCTGAAATGTACAGTGGCAACAATGCCGAATTACCAACAATAACTGCAATATTGCTCTCTATATCCAATTTTCTTAAGC
AAAATATTGGCATTTTGCTATTTTTCGCTTTGAGTTTTGTTCTATTTTATTACTTTTATCTAAAACGCCAGACTTGGTTT
CATCAAAAGAAAAATCAACTTATTTCTATCACGCCTATTTTTGGCACAATTCAAAAACTTTCACGTTTAGTGAACTTTAG
TCACAGTTTACAAATTATGTTACAGGCTGGCGTACCGCTTAATCAAGCACTAGACAGTTTTCTCCCTCGCACACAAACGT
GGCAAACCAAGAAAACGCTTGTAAATGACATCGTATTAGATAAAGAAGTGCGGTCAATTTTACAATGGGTTTCTCAAGGC
TATGCGTTTTCTGATAGTGTAAGTAGCGATCTTTTCCCGATGGAAGCACAACAAATGCTCCAAATTGGCGAACAAAGCGG
AAAACTCGCTTTGATGCTAGAGCATATCGCGGATAATTACCAAGAAAAACTTAATCATCAAATTGACTTACTCTCACAAA
TGCTAGAACCATTAATGATGGTAATTATCGGCAGTCTGATTGGAATTATTATGATGGGAATGTATTTACCTATCTTTAAT
ATGGGCTCTGTTATTCAATGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| pilC | Haemophilus influenzae 86-028NP |
98.03 |
100 |
0.98 |
| pilC | Haemophilus influenzae Rd KW20 |
97.291 |
100 |
0.973 |
| pilC | Glaesserella parasuis strain SC1401 |
38.404 |
98.768 |
0.379 |