Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | DQM42_RS06520 | Genome accession | NZ_LS483351 |
| Coordinates | 1205287..1207530 (-) | Length | 747 a.a. |
| NCBI ID | WP_002983969.1 | Uniprot ID | - |
| Organism | Streptococcus pyogenes strain NCTC8195 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1200287..1212530
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| DQM42_RS06490 (NCTC8195_01310) | - | 1200925..1202145 (+) | 1221 | WP_002983986.1 | DUF3114 domain-containing protein | - |
| DQM42_RS06495 (NCTC8195_01311) | - | 1202259..1202849 (-) | 591 | WP_002983984.1 | serine hydrolase | - |
| DQM42_RS10210 | - | 1202846..1203073 (-) | 228 | WP_226316535.1 | hypothetical protein | - |
| DQM42_RS06505 (NCTC8195_01312) | - | 1203074..1203307 (-) | 234 | WP_002983979.1 | hypothetical protein | - |
| DQM42_RS06510 (NCTC8195_01313) | sodA | 1203474..1204079 (-) | 606 | WP_002983977.1 | superoxide dismutase SodA | - |
| DQM42_RS06515 (NCTC8195_01314) | holA | 1204176..1205216 (-) | 1041 | WP_111690673.1 | DNA polymerase III subunit delta | - |
| DQM42_RS06520 (NCTC8195_01315) | comEC/celB | 1205287..1207530 (-) | 2244 | WP_002983969.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| DQM42_RS06525 (NCTC8195_01316) | - | 1207511..1208173 (-) | 663 | WP_002983967.1 | ComEA family DNA-binding protein | - |
| DQM42_RS06530 (NCTC8195_01317) | - | 1208373..1209113 (-) | 741 | WP_011888793.1 | lysophospholipid acyltransferase family protein | - |
| DQM42_RS06535 (NCTC8195_01318) | - | 1209231..1210007 (+) | 777 | WP_011888792.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| DQM42_RS06540 (NCTC8195_01319) | - | 1209997..1210275 (+) | 279 | WP_002983958.1 | GIY-YIG nuclease family protein | - |
| DQM42_RS06545 (NCTC8195_01320) | - | 1210299..1212299 (-) | 2001 | WP_002983956.1 | KUP/HAK/KT family potassium transporter | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 85498.47 Da Isoelectric Point: 9.7989
>NTDB_id=1019599 DQM42_RS06520 WP_002983969.1 1205287..1207530(-) (comEC/celB) [Streptococcus pyogenes strain NCTC8195]
MTFSWTKLVPLSKIQFAFLILVLFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCTLFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQSFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQIEQLEVISPKSICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTALLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLINEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
IDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGRTSWHLETVR
MTFSWTKLVPLSKIQFAFLILVLFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCTLFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQSFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQIEQLEVISPKSICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTALLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLINEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
IDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGRTSWHLETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=1019599 DQM42_RS06520 WP_002983969.1 1205287..1207530(-) (comEC/celB) [Streptococcus pyogenes strain NCTC8195]
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTCTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTACTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATCGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGGCTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCAAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTTACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCCCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCAATGTCAATGGTCTTAACAGCTCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGCAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGATCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ATTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTCGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTCTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTACTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATCGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGGCTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCAAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTTACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCCCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCAATGTCAATGGTCTTAACAGCTCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGCAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGATCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ATTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTCGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
46.185 |
100 |
0.462 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
45.979 |
99.866 |
0.459 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.114 |
100 |
0.451 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae D39 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae R6 |
44.92 |
100 |
0.45 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
40.671 |
99.732 |
0.406 |