Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | GGS_RS06965 | Genome accession | NC_018712 |
| Coordinates | 1418041..1420284 (-) | Length | 747 a.a. |
| NCBI ID | WP_015017202.1 | Uniprot ID | - |
| Organism | Streptococcus dysgalactiae subsp. equisimilis RE378 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1413041..1425284
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| GGS_RS06945 (GGS_1317) | - | 1413649..1414869 (+) | 1221 | WP_015017200.1 | DUF3114 domain-containing protein | - |
| GGS_RS06950 (GGS_1318) | - | 1414990..1416052 (-) | 1063 | Protein_1338 | serine hydrolase | - |
| GGS_RS06955 (GGS_1319) | sodA | 1416219..1416824 (-) | 606 | WP_003054499.1 | superoxide dismutase SodA | - |
| GGS_RS06960 (GGS_1320) | holA | 1416914..1417960 (-) | 1047 | WP_015017201.1 | DNA polymerase III subunit delta | - |
| GGS_RS06965 (GGS_1321) | comEC/celB | 1418041..1420284 (-) | 2244 | WP_015017202.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| GGS_RS06970 (GGS_1322) | comEA | 1420265..1420927 (-) | 663 | WP_003057999.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| GGS_RS06975 (GGS_1323) | - | 1421324..1422064 (-) | 741 | WP_003062277.1 | 1-acyl-sn-glycerol-3-phosphate acyltransferase | - |
| GGS_RS06980 (GGS_1324) | - | 1422182..1422958 (+) | 777 | WP_148275174.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| GGS_RS06985 | - | 1422948..1423226 (+) | 279 | WP_003061674.1 | GIY-YIG nuclease family protein | - |
| GGS_RS06990 (GGS_1325) | - | 1423250..1425250 (-) | 2001 | WP_003061221.1 | potassium transporter Kup | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 85150.67 Da Isoelectric Point: 9.2618
>NTDB_id=44917 GGS_RS06965 WP_015017202.1 1418041..1420284(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis RE378]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=44917 GGS_RS06965 WP_015017202.1 1418041..1420284(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis RE378]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGCTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTGTCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAATGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAAATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGCTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTGTCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAATGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAAATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
45.772 |
99.732 |
0.456 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
45.71 |
99.866 |
0.456 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.187 |
100 |
0.452 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae D39 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae R6 |
44.92 |
100 |
0.45 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
41.588 |
99.465 |
0.414 |