Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | SDEG_RS07105 | Genome accession | NC_012891 |
| Coordinates | 1401868..1404111 (-) | Length | 747 a.a. |
| NCBI ID | WP_012767256.1 | Uniprot ID | - |
| Organism | Streptococcus dysgalactiae subsp. equisimilis GGS_124 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1396868..1409111
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| SDEG_RS07085 (SDEG_1445) | - | 1397476..1398696 (+) | 1221 | WP_003056368.1 | DUF3114 domain-containing protein | - |
| SDEG_RS07090 (SDEG_1446) | - | 1398817..1399878 (-) | 1062 | WP_012767255.1 | serine hydrolase | - |
| SDEG_RS07095 (SDEG_1447) | sodA | 1400045..1400650 (-) | 606 | WP_003054499.1 | superoxide dismutase SodA | - |
| SDEG_RS07100 (SDEG_1448) | holA | 1400747..1401787 (-) | 1041 | WP_003054496.1 | DNA polymerase III subunit delta | - |
| SDEG_RS07105 (SDEG_1449) | comEC/celB | 1401868..1404111 (-) | 2244 | WP_012767256.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| SDEG_RS07110 (SDEG_1450) | - | 1404092..1404754 (-) | 663 | WP_012767257.1 | helix-hairpin-helix domain-containing protein | - |
| SDEG_RS07115 (SDEG_1451) | - | 1405151..1405891 (-) | 741 | WP_003062277.1 | lysophospholipid acyltransferase family protein | - |
| SDEG_RS07120 (SDEG_1452) | - | 1406009..1406785 (+) | 777 | WP_143606092.1 | methyltransferase | - |
| SDEG_RS07125 (SDEG_1453) | - | 1406775..1407053 (+) | 279 | WP_003061674.1 | GIY-YIG nuclease family protein | - |
| SDEG_RS07130 (SDEG_1454) | - | 1407077..1409077 (-) | 2001 | WP_012767260.1 | KUP/HAK/KT family potassium transporter | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 85099.58 Da Isoelectric Point: 9.2617
>NTDB_id=30685 SDEG_RS07105 WP_012767256.1 1401868..1404111(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis GGS_124]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAGFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGQQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAGFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGQQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=30685 SDEG_RS07105 WP_012767256.1 1401868..1404111(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis GGS_124]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGGCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGTTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTATCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGTAATACCCTAAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCAACAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGGCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGTTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTATCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGTAATACCCTAAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCAACAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
45.772 |
99.732 |
0.456 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
45.71 |
99.866 |
0.456 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.187 |
100 |
0.452 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae D39 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae R6 |
44.92 |
100 |
0.45 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
41.723 |
99.465 |
0.415 |