Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | H7790_RS05790 | Genome accession | NZ_CP060645 |
| Coordinates | 1168163..1170406 (-) | Length | 747 a.a. |
| NCBI ID | WP_115230474.1 | Uniprot ID | - |
| Organism | Streptococcus pyogenes strain TSPY1349 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 1163163..1175406
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| H7790_RS05760 (H7790_05785) | - | 1163803..1165023 (+) | 1221 | WP_030126414.1 | DUF3114 domain-containing protein | - |
| H7790_RS05765 (H7790_05790) | - | 1165242..1165727 (-) | 486 | WP_281727030.1 | serine hydrolase | - |
| H7790_RS05770 (H7790_05795) | - | 1165724..1165972 (-) | 249 | WP_085634525.1 | serine hydrolase | - |
| H7790_RS05775 (H7790_05800) | - | 1166001..1166183 (-) | 183 | WP_023078840.1 | hypothetical protein | - |
| H7790_RS05780 (H7790_05805) | sodA | 1166350..1166955 (-) | 606 | WP_023612500.1 | superoxide dismutase SodA | - |
| H7790_RS05785 (H7790_05810) | holA | 1167052..1168092 (-) | 1041 | WP_115230475.1 | DNA polymerase III subunit delta | - |
| H7790_RS05790 (H7790_05815) | comEC/celB | 1168163..1170406 (-) | 2244 | WP_115230474.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| H7790_RS05795 (H7790_05820) | - | 1170387..1171049 (-) | 663 | WP_002983967.1 | ComEA family DNA-binding protein | - |
| H7790_RS05800 (H7790_05825) | - | 1171249..1171989 (-) | 741 | WP_022554937.1 | lysophospholipid acyltransferase family protein | - |
| H7790_RS05805 (H7790_05830) | - | 1172107..1172883 (+) | 777 | WP_136073817.1 | tRNA1(Val) (adenine(37)-N6)-methyltransferase | - |
| H7790_RS05810 (H7790_05835) | - | 1172873..1173151 (+) | 279 | WP_003061674.1 | GIY-YIG nuclease family protein | - |
| H7790_RS05815 (H7790_05840) | - | 1173175..1175175 (-) | 2001 | WP_115230473.1 | potassium transporter Kup | - |
Sequence
Protein
Download Length: 747 a.a. Molecular weight: 85549.40 Da Isoelectric Point: 9.6063
>NTDB_id=416178 H7790_RS05790 WP_115230474.1 1168163..1170406(-) (comEC/celB) [Streptococcus pyogenes strain TSPY1349]
MTFSWTKLMPLSKIQFAFLILVLFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLIQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQDLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR
MTFSWTKLMPLSKIQFAFLILVLFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLIQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQDLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR
Nucleotide
Download Length: 2244 bp
>NTDB_id=416178 H7790_RS05790 WP_115230474.1 1168163..1170406(-) (comEC/celB) [Streptococcus pyogenes strain TSPY1349]
ATGACATTTTCTTGGACTAAGCTAATGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTCTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGATTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGGCTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCACACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGACTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGTCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTTGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG
ATGACATTTTCTTGGACTAAGCTAATGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTCTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGATTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGGCTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCACACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGACTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGTCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTTGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
46.319 |
100 |
0.463 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
46.113 |
99.866 |
0.461 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
45.114 |
100 |
0.451 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae D39 |
44.92 |
100 |
0.45 |
| comEC/celB | Streptococcus pneumoniae R6 |
44.92 |
100 |
0.45 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
40.897 |
98.527 |
0.403 |