Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | H1W80_RS07055 | Genome accession | NZ_LR822040 |
| Coordinates | 1358960..1361200 (-) | Length | 746 a.a. |
| NCBI ID | WP_087010098.1 | Uniprot ID | - |
| Organism | Streptococcus thermophilus isolate STH_CIRM_1125 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1353960..1366200
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| H1W80_RS07035 (STHERMO_1574) | - | 1354824..1355684 (-) | 861 | WP_011226395.1 | methionyl aminopeptidase | - |
| H1W80_RS07040 (STHERMO_1575) | spxR | 1355728..1357008 (-) | 1281 | WP_096811595.1 | CBS-HotDog domain-containing transcription factor SpxR | - |
| H1W80_RS07045 (STHERMO_1576) | - | 1357001..1357546 (-) | 546 | WP_087010097.1 | GNAT family N-acetyltransferase | - |
| H1W80_RS07050 (STHERMO_1577) | - | 1357612..1358874 (-) | 1263 | WP_022096991.1 | UDP-N-acetylglucosamine 1-carboxyvinyltransferase | - |
| H1W80_RS07055 (STHERMO_1578) | comEC/celB | 1358960..1361200 (-) | 2241 | WP_087010098.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| H1W80_RS07060 (STHERMO_1579) | comEA | 1361190..1361885 (-) | 696 | WP_180473307.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| H1W80_RS07065 (STHERMO_1580) | - | 1361993..1362748 (-) | 756 | WP_023909871.1 | lysophospholipid acyltransferase family protein | - |
| H1W80_RS10025 (STHERMO_1581) | - | 1362948..1363481 (+) | 534 | WP_087010099.1 | polysaccharide deacetylase family protein | - |
| H1W80_RS09660 (STHERMO_1582) | - | 1363415..1363813 (+) | 399 | WP_414487346.1 | peptidoglycan GlcNAc deacetylase | - |
| H1W80_RS07075 (STHERMO_1583) | - | 1363863..1364627 (+) | 765 | WP_180473308.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| H1W80_RS07080 (STHERMO_1584) | - | 1364631..1364900 (+) | 270 | WP_011226404.1 | GIY-YIG nuclease family protein | - |
Sequence
Protein
Download Length: 746 a.a. Molecular weight: 84852.80 Da Isoelectric Point: 9.8860
>NTDB_id=1011578 H1W80_RS07055 WP_087010098.1 1358960..1361200(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_1125]
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYQLKSDKEQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHVVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKEKWQEGNQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMTSYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYQLKSDKEQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHVVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKEKWQEGNQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMTSYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR
Nucleotide
Download Length: 2241 bp
>NTDB_id=1011578 H1W80_RS07055 WP_087010098.1 1358960..1361200(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_1125]
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCAGCTAAAATCTGATAAGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGATTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGGAAAAATGGCAAGAGGGGAACCAGACAAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTATTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGACTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCAGCTAAAATCTGATAAGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGATTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGGAAAAATGGCAAGAGGGGAACCAGACAAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTATTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGACTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis NCTC 12261 |
47.721 |
100 |
0.477 |
| comEC/celB | Streptococcus mitis SK321 |
46.854 |
100 |
0.469 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.917 |
100 |
0.46 |
| comEC/celB | Streptococcus pneumoniae D39 |
45.649 |
100 |
0.457 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
45.649 |
100 |
0.457 |
| comEC/celB | Streptococcus pneumoniae R6 |
45.649 |
100 |
0.457 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
45.241 |
97.185 |
0.44 |