Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | H0511_RS07245 | Genome accession | NZ_LR822017 |
| Coordinates | 1424722..1426962 (-) | Length | 746 a.a. |
| NCBI ID | WP_179973926.1 | Uniprot ID | - |
| Organism | Streptococcus thermophilus isolate STH_CIRM_336 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1419722..1431962
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| H0511_RS07225 (STHERMO_1621) | - | 1420586..1421446 (-) | 861 | WP_179973925.1 | methionyl aminopeptidase | - |
| H0511_RS07230 (STHERMO_1622) | spxR | 1421490..1422770 (-) | 1281 | WP_179972170.1 | CBS-HotDog domain-containing transcription factor SpxR | - |
| H0511_RS07235 | - | 1422763..1423308 (-) | 546 | Protein_1391 | GNAT family N-acetyltransferase | - |
| H0511_RS07240 (STHERMO_1625) | - | 1423374..1424636 (-) | 1263 | WP_179972171.1 | UDP-N-acetylglucosamine 1-carboxyvinyltransferase | - |
| H0511_RS07245 (STHERMO_1626) | comEC/celB | 1424722..1426962 (-) | 2241 | WP_179973926.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| H0511_RS07250 (STHERMO_1627) | comEA | 1426952..1427647 (-) | 696 | WP_179973927.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| H0511_RS07255 (STHERMO_1628) | - | 1427753..1428508 (-) | 756 | WP_179973928.1 | lysophospholipid acyltransferase family protein | - |
| H0511_RS10620 (STHERMO_1629) | - | 1428602..1428808 (+) | 207 | WP_232087319.1 | hypothetical protein | - |
| H0511_RS10130 (STHERMO_1630) | - | 1428911..1429549 (+) | 639 | WP_269473445.1 | polysaccharide deacetylase family protein | - |
| H0511_RS07265 (STHERMO_1631) | - | 1429599..1430363 (+) | 765 | WP_179972175.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| H0511_RS07270 (STHERMO_1632) | - | 1430367..1430636 (+) | 270 | WP_179972176.1 | GIY-YIG nuclease family protein | - |
Sequence
Protein
Download Length: 746 a.a. Molecular weight: 85094.12 Da Isoelectric Point: 9.9593
>NTDB_id=1009771 H0511_RS07245 WP_179973926.1 1424722..1426962(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_336]
MWLKKSPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRATLKLVGLVGGFFLVYFLFLYHIAIMQDKQ
APAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYRLKSDKEKHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHVVTPKSISPIAFFHQLRRRALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILTILLPFSIFYGLMTGWTASVLRSLIQSLLSECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNPLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVLMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFVSKEKWQEGSQTSNAEKTLIPYLQERGVSQIDYLVLTHTDT
DHIGDLEEVAKRFKIKEICVSKGALTKPSFAKRIRFLKRPVRTLKAGDKLTMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMASYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDLDGAIRFKGWFQLSSETVR
MWLKKSPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRATLKLVGLVGGFFLVYFLFLYHIAIMQDKQ
APAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYRLKSDKEKHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHVVTPKSISPIAFFHQLRRRALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILTILLPFSIFYGLMTGWTASVLRSLIQSLLSECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNPLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVLMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFVSKEKWQEGSQTSNAEKTLIPYLQERGVSQIDYLVLTHTDT
DHIGDLEEVAKRFKIKEICVSKGALTKPSFAKRIRFLKRPVRTLKAGDKLTMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMASYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDLDGAIRFKGWFQLSSETVR
Nucleotide
Download Length: 2241 bp
>NTDB_id=1009771 H0511_RS07245 WP_179973926.1 1424722..1426962(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_336]
ATGTGGCTTAAAAAATCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAACTCTAA
AGTTGGTGGGACTTGTAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAG
GCTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCGGCTAAAATCTGATAAGGAGAAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTCCATCAATTGAGGAGGAGGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACCAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTACTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGTCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTGGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACCCACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTTGATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
GACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGTCTCTAAGGAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATTTACAGGAAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GATCATATTGGTGATTTGGAGGAAGTGGCTAAACGGTTTAAGATTAAGGAAATTTGTGTCAGTAAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAACGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGACTATGATGG
GAAGTAACCTACAGGTTCTTTATCCTAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTTTGTTTACTGGTGATTTAGAAAAAGAAGGAGAGGAGGAATTAATGGCTAGCTATCCAAATTTAAA
AGTAAGGGTCCTAAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCTGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCTGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
ATGTGGCTTAAAAAATCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAACTCTAA
AGTTGGTGGGACTTGTAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAG
GCTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCGGCTAAAATCTGATAAGGAGAAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTCCATCAATTGAGGAGGAGGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACCAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTACTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGTCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTGGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACCCACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTTGATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
GACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGTCTCTAAGGAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATTTACAGGAAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GATCATATTGGTGATTTGGAGGAAGTGGCTAAACGGTTTAAGATTAAGGAAATTTGTGTCAGTAAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAACGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGACTATGATGG
GAAGTAACCTACAGGTTCTTTATCCTAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTTTGTTTACTGGTGATTTAGAAAAAGAAGGAGAGGAGGAATTAATGGCTAGCTATCCAAATTTAAA
AGTAAGGGTCCTAAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCTGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCTGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis NCTC 12261 |
47.855 |
100 |
0.479 |
| comEC/celB | Streptococcus mitis SK321 |
46.854 |
100 |
0.469 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
46.051 |
100 |
0.461 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
45.783 |
100 |
0.458 |
| comEC/celB | Streptococcus pneumoniae D39 |
45.783 |
100 |
0.458 |
| comEC/celB | Streptococcus pneumoniae R6 |
45.783 |
100 |
0.458 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
44.337 |
97.051 |
0.43 |