Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | DQM44_RS06870 | Genome accession | NZ_LS483318 |
| Coordinates | 1337234..1339477 (-) | Length | 747 a.a. |
| NCBI ID | WP_044565459.1 | Uniprot ID | - |
| Organism | Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1332234..1344477
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| DQM44_RS06850 (NCTC5370_01416) | - | 1332843..1334063 (+) | 1221 | WP_015017200.1 | DUF3114 domain-containing protein | - |
| DQM44_RS06855 (NCTC5370_01417) | - | 1334184..1335245 (-) | 1062 | WP_046166020.1 | serine hydrolase | - |
| DQM44_RS06860 (NCTC5370_01418) | sodA | 1335412..1336017 (-) | 606 | WP_014612432.1 | superoxide dismutase SodA | - |
| DQM44_RS06865 (NCTC5370_01419) | holA | 1336107..1337153 (-) | 1047 | WP_046166021.1 | DNA polymerase III subunit delta | - |
| DQM44_RS06870 (NCTC5370_01420) | comEC/celB | 1337234..1339477 (-) | 2244 | WP_044565459.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| DQM44_RS06875 (NCTC5370_01421) | comEA | 1339458..1340120 (-) | 663 | WP_003057999.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| DQM44_RS06880 (NCTC5370_01422) | - | 1340517..1341257 (-) | 741 | WP_022554937.1 | 1-acyl-sn-glycerol-3-phosphate acyltransferase | - |
| DQM44_RS06885 (NCTC5370_01423) | - | 1341375..1342151 (+) | 777 | WP_080286812.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| DQM44_RS06890 (NCTC5370_01424) | - | 1342141..1342419 (+) | 279 | WP_003061674.1 | GIY-YIG nuclease family protein | - |
| DQM44_RS06895 (NCTC5370_01425) | - | 1342443..1344443 (-) | 2001 | WP_022554940.1 | potassium transporter Kup | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 84997.50 Da Isoelectric Point: 9.4078
>NTDB_id=1016735 DQM44_RS06870 WP_044565459.1 1337234..1339477(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=1016735 DQM44_RS06870 WP_044565459.1 1337234..1339477(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTGGTTCCGGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGATATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTGGTTCCGGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGATATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis NCTC 12261 |
46.247 |
99.866 |
0.462 |
| comEC/celB | Streptococcus mitis SK321 |
46.309 |
99.732 |
0.462 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.722 |
100 |
0.458 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
45.455 |
100 |
0.455 |
| comEC/celB | Streptococcus pneumoniae D39 |
45.455 |
100 |
0.455 |
| comEC/celB | Streptococcus pneumoniae R6 |
45.455 |
100 |
0.455 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
41.398 |
99.598 |
0.412 |