Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | ETT58_RS05950 | Genome accession | NZ_CP035441 |
| Coordinates | 1146229..1148472 (-) | Length | 747 a.a. |
| NCBI ID | WP_010922436.1 | Uniprot ID | - |
| Organism | Streptococcus pyogenes strain emm1 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1141229..1153472
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| ETT58_RS05920 (ETT58_05915) | - | 1141868..1143088 (+) | 1221 | WP_010922430.1 | DUF3114 domain-containing protein | - |
| ETT58_RS05925 (ETT58_05920) | - | 1143202..1143792 (-) | 591 | WP_010922431.1 | serine hydrolase | - |
| ETT58_RS05930 (ETT58_05925) | - | 1143789..1144037 (-) | 249 | WP_010922432.1 | serine hydrolase | - |
| ETT58_RS05935 (ETT58_05930) | - | 1144022..1144249 (-) | 228 | WP_010922433.1 | hypothetical protein | - |
| ETT58_RS05940 (ETT58_05935) | sodA | 1144416..1145021 (-) | 606 | WP_010922434.1 | superoxide dismutase SodA | - |
| ETT58_RS05945 (ETT58_05940) | holA | 1145118..1146158 (-) | 1041 | WP_010922435.1 | DNA polymerase III subunit delta | - |
| ETT58_RS05950 (ETT58_05945) | comEC/celB | 1146229..1148472 (-) | 2244 | WP_010922436.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| ETT58_RS05955 (ETT58_05950) | - | 1148453..1149115 (-) | 663 | WP_002983967.1 | ComEA family DNA-binding protein | - |
| ETT58_RS05960 (ETT58_05955) | - | 1149315..1150055 (-) | 741 | WP_011285604.1 | 1-acyl-sn-glycerol-3-phosphate acyltransferase | - |
| ETT58_RS05965 (ETT58_05960) | - | 1150173..1150949 (+) | 777 | WP_010922438.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| ETT58_RS05970 (ETT58_05965) | - | 1150939..1151217 (+) | 279 | WP_002989164.1 | GIY-YIG nuclease family protein | - |
| ETT58_RS05975 (ETT58_05970) | - | 1151241..1153241 (-) | 2001 | WP_010922439.1 | potassium transporter Kup | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 85521.38 Da Isoelectric Point: 9.7095
>NTDB_id=302227 ETT58_RS05950 WP_010922436.1 1146229..1148472(-) (comEC/celB) [Streptococcus pyogenes strain emm1]
MTFSWTKLVPLSKIQFAFLILVFFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLTYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGRTSWHLETVR
MTFSWTKLVPLSKIQFAFLILVFFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLTYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGRTSWHLETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=302227 ETT58_RS05950 WP_010922436.1 1146229..1148472(-) (comEC/celB) [Streptococcus pyogenes strain emm1]
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTTTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGACTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCAATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACACTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATCACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTCGGACAAGCTGGCATCTTGAAACGGTTCG
TTAG
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTTTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGACTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCAATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACACTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATCACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTCGGACAAGCTGGCATCTTGAAACGGTTCG
TTAG
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
46.051 |
100 |
0.461 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
45.845 |
99.866 |
0.458 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
44.98 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
44.786 |
100 |
0.448 |
| comEC/celB | Streptococcus pneumoniae D39 |
44.786 |
100 |
0.448 |
| comEC/celB | Streptococcus pneumoniae R6 |
44.786 |
100 |
0.448 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
41.491 |
95.181 |
0.395 |