Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | STHERMO_RS07275 | Genome accession | NZ_LR822006 |
| Coordinates | 1392638..1394878 (-) | Length | 746 a.a. |
| NCBI ID | WP_179970516.1 | Uniprot ID | - |
| Organism | Streptococcus thermophilus isolate STH_CIRM_16 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1387638..1399878
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| STHERMO_RS07255 (STHERMO_1605) | - | 1388502..1389362 (-) | 861 | WP_022096994.1 | methionyl aminopeptidase | - |
| STHERMO_RS07260 (STHERMO_1606) | spxR | 1389406..1390686 (-) | 1281 | WP_179970515.1 | CBS-HotDog domain-containing transcription factor SpxR | - |
| STHERMO_RS07265 (STHERMO_1607) | - | 1390679..1391224 (-) | 546 | WP_022096992.1 | GNAT family N-acetyltransferase | - |
| STHERMO_RS07270 (STHERMO_1608) | - | 1391290..1392552 (-) | 1263 | WP_022096991.1 | UDP-N-acetylglucosamine 1-carboxyvinyltransferase | - |
| STHERMO_RS07275 (STHERMO_1609) | comEC/celB | 1392638..1394878 (-) | 2241 | WP_179970516.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| STHERMO_RS07280 (STHERMO_1610) | comEA | 1394868..1395563 (-) | 696 | WP_179970517.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| STHERMO_RS07285 (STHERMO_1611) | - | 1395672..1396427 (-) | 756 | WP_002948862.1 | lysophospholipid acyltransferase family protein | - |
| STHERMO_RS10280 (STHERMO_1612) | - | 1396627..1397160 (+) | 534 | WP_011226401.1 | polysaccharide deacetylase family protein | - |
| STHERMO_RS09860 (STHERMO_1613) | - | 1397094..1397492 (+) | 399 | WP_288576965.1 | peptidoglycan GlcNAc deacetylase | - |
| STHERMO_RS07295 (STHERMO_1614) | - | 1397542..1398306 (+) | 765 | WP_011226403.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| STHERMO_RS07300 (STHERMO_1615) | - | 1398310..1398579 (+) | 270 | WP_011226404.1 | GIY-YIG nuclease family protein | - |
Sequence
Protein
Download Length: 746 a.a. Molecular weight: 84879.78 Da Isoelectric Point: 9.8860
>NTDB_id=1008852 STHERMO_RS07275 WP_179970516.1 1392638..1394878(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_16]
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYQLKSDKEQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHAVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQIGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VFFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVFLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKEKWQEGSQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMTSYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYQLKSDKEQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHAVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQIGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VFFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVFLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKEKWQEGSQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMTSYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR
Nucleotide
Download Length: 2241 bp
>NTDB_id=1008852 STHERMO_RS07275 WP_179970516.1 1392638..1394878(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_16]
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCAGCTAAAATCTGATAAGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGCCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGATTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTGAGTTGTTCTTACGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTATTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTTCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGGAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACCGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTATTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGACTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCAGCTAAAATCTGATAAGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGCCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGATTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTGAGTTGTTCTTACGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTATTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTTCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGGAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACCGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTATTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGACTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis NCTC 12261 |
47.319 |
100 |
0.473 |
| comEC/celB | Streptococcus mitis SK321 |
46.452 |
100 |
0.465 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.515 |
100 |
0.456 |
| comEC/celB | Streptococcus pneumoniae D39 |
45.248 |
100 |
0.453 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
45.248 |
100 |
0.453 |
| comEC/celB | Streptococcus pneumoniae R6 |
45.248 |
100 |
0.453 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
44.966 |
97.185 |
0.437 |