Detailed information
Overview
| Name | comEC/celB | Type | Machinery gene |
| Locus tag | SanJ4211_RS04395 | Genome accession | NZ_CP012805 |
| Coordinates | 871522..873750 (+) | Length | 742 a.a. |
| NCBI ID | WP_037613581.1 | Uniprot ID | - |
| Organism | Streptococcus anginosus strain J4211 | ||
| Function | ssDNA transport into the cell (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 866522..878750
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| SanJ4211_RS04375 (SanJ4211_0858) | smpB | 868742..869209 (+) | 468 | WP_003024738.1 | SsrA-binding protein SmpB | - |
| SanJ4211_RS04390 (SanJ4211_0861) | comEA/celA/cilE | 870834..871538 (+) | 705 | WP_003024731.1 | helix-hairpin-helix domain-containing protein | Machinery gene |
| SanJ4211_RS04395 (SanJ4211_0862) | comEC/celB | 871522..873750 (+) | 2229 | WP_037613581.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| SanJ4211_RS04400 (SanJ4211_0863) | - | 873832..874398 (+) | 567 | WP_021001633.1 | DUF805 domain-containing protein | - |
| SanJ4211_RS04405 (SanJ4211_0865) | - | 875029..876015 (+) | 987 | WP_003024723.1 | Gfo/Idh/MocA family protein | - |
| SanJ4211_RS04410 (SanJ4211_0866) | - | 876037..876690 (+) | 654 | WP_003024719.1 | uracil-DNA glycosylase | - |
| SanJ4211_RS04415 (SanJ4211_0867) | mutX | 876727..877197 (+) | 471 | WP_021001634.1 | NUDIX hydrolase | Machinery gene |
| SanJ4211_RS04420 (SanJ4211_0868) | - | 877210..878487 (+) | 1278 | WP_057489636.1 | dihydroorotase | - |
Sequence
Protein
Download Length: 742 a.a. Molecular weight: 85164.95 Da Isoelectric Point: 10.0221
>NTDB_id=136527 SanJ4211_RS04395 WP_037613581.1 871522..873750(+) (comEC/celB) [Streptococcus anginosus strain J4211]
MSQWIKRFPIKPIYIAFLLVWLYFAIYQSSWLGWLGFIFLVICLFRFYSPKECFMTFMILSCFAGFFFVRREIAEQKTKV
EPSPIRQVAVLPDTIKVNGDSLSFRGKANRQTYQVYYKLKSKEEQLAFQNLSSLVTLTVEGEFEIPEKKRNFAGFDYQSY
LKTQGIYRILKVDTILSSQDRISLHPFEWLSSWRRKALVFIKNHFPNPMSNYMTGLLFGALDTSFDEMSNLYSSLGIIHL
FALSGMQVGFFMEGFRKLLLRLGFTQEMVRKCQYPFSFFYAGMTGFSVSVVRSLVQKLLSQHGITKLDNFALTMMILSLI
MPSFLLSAGGVLSCAYAFVISVIDFESLTSWRKVVVESSVISLGVLPILIFYFGEFQPWSILLTFVFSLIFDTMMLPGLM
FIFLFSPLIKLTQVNFLFEGLENSIRWIASVFGKPIVFGQPSPLLLIVMLLVLAILYDIRQNKKWVIFLSLFLSLLFFIN
KFPLQNEITMVDVGQGDSIFLRDWKGKNVLIDVGGREEIRTKEAWQKRATSSNAEKTLIPYLKSRGVDTIDTLVLTNPNP
DYAGDVLGVAKKFAIKKIYISRSSLSNADFLKKLRETNTFIHVIKQGDKLPIFDHHLQVLSGASKNDHSIVLYGQFFRTR
FLFASDLKEEEEAKLMQHYPKLKTDILKVGQHGAKSSSSSKFLQQIEPTVALISVGKNNQSKQPSQDTIERFAQLPAKVY
RTDEQGAVKFSGWTNWRLEMVK
MSQWIKRFPIKPIYIAFLLVWLYFAIYQSSWLGWLGFIFLVICLFRFYSPKECFMTFMILSCFAGFFFVRREIAEQKTKV
EPSPIRQVAVLPDTIKVNGDSLSFRGKANRQTYQVYYKLKSKEEQLAFQNLSSLVTLTVEGEFEIPEKKRNFAGFDYQSY
LKTQGIYRILKVDTILSSQDRISLHPFEWLSSWRRKALVFIKNHFPNPMSNYMTGLLFGALDTSFDEMSNLYSSLGIIHL
FALSGMQVGFFMEGFRKLLLRLGFTQEMVRKCQYPFSFFYAGMTGFSVSVVRSLVQKLLSQHGITKLDNFALTMMILSLI
MPSFLLSAGGVLSCAYAFVISVIDFESLTSWRKVVVESSVISLGVLPILIFYFGEFQPWSILLTFVFSLIFDTMMLPGLM
FIFLFSPLIKLTQVNFLFEGLENSIRWIASVFGKPIVFGQPSPLLLIVMLLVLAILYDIRQNKKWVIFLSLFLSLLFFIN
KFPLQNEITMVDVGQGDSIFLRDWKGKNVLIDVGGREEIRTKEAWQKRATSSNAEKTLIPYLKSRGVDTIDTLVLTNPNP
DYAGDVLGVAKKFAIKKIYISRSSLSNADFLKKLRETNTFIHVIKQGDKLPIFDHHLQVLSGASKNDHSIVLYGQFFRTR
FLFASDLKEEEEAKLMQHYPKLKTDILKVGQHGAKSSSSSKFLQQIEPTVALISVGKNNQSKQPSQDTIERFAQLPAKVY
RTDEQGAVKFSGWTNWRLEMVK
Nucleotide
Download Length: 2229 bp
>NTDB_id=136527 SanJ4211_RS04395 WP_037613581.1 871522..873750(+) (comEC/celB) [Streptococcus anginosus strain J4211]
ATGTCACAGTGGATTAAAAGATTTCCGATTAAGCCGATTTACATTGCTTTTTTGCTCGTCTGGTTGTATTTTGCAATCTA
TCAAAGTAGCTGGTTAGGCTGGTTGGGTTTTATCTTTCTGGTGATTTGTCTTTTTCGCTTTTATTCACCGAAAGAATGTT
TCATGACCTTCATGATCCTCTCTTGTTTTGCTGGTTTTTTCTTTGTTCGTAGGGAAATAGCAGAGCAGAAGACGAAAGTA
GAACCTTCTCCCATAAGACAAGTGGCAGTTCTACCTGACACGATTAAGGTAAATGGTGATTCGCTTTCTTTTCGTGGTAA
AGCTAATAGGCAGACTTATCAAGTTTACTACAAATTGAAATCAAAGGAAGAACAGTTGGCTTTTCAAAATCTCTCTAGTC
TGGTTACATTGACCGTTGAAGGGGAATTTGAAATCCCTGAGAAGAAGCGTAATTTTGCTGGTTTTGATTACCAATCCTAT
TTAAAAACGCAAGGGATTTATCGAATTTTAAAAGTGGATACCATTTTATCGAGCCAAGATAGAATCAGCTTGCACCCTTT
TGAGTGGCTTTCTAGCTGGCGAAGAAAAGCACTGGTATTTATCAAGAACCATTTTCCAAATCCGATGAGTAATTACATGA
CAGGACTCTTATTTGGTGCCTTGGATACATCCTTTGACGAAATGAGCAATCTTTATTCTAGCTTGGGAATTATTCATTTA
TTTGCGCTGTCTGGCATGCAAGTTGGCTTTTTTATGGAGGGATTTCGCAAGTTACTGTTAAGGCTGGGGTTTACACAAGA
AATGGTTCGTAAATGCCAATATCCATTTTCTTTCTTTTATGCGGGAATGACTGGATTTTCAGTATCCGTTGTACGGAGCT
TAGTTCAGAAATTATTATCGCAACATGGTATCACTAAGTTAGATAATTTTGCTTTAACGATGATGATATTGTCCTTGATT
ATGCCGTCCTTTCTTTTGTCGGCAGGAGGAGTTCTCTCCTGTGCTTATGCTTTTGTCATTAGTGTGATAGATTTTGAAAG
TCTGACTTCTTGGCGAAAAGTTGTTGTAGAGAGTAGCGTTATTTCACTTGGTGTTTTACCAATTCTAATCTTTTACTTTG
GTGAATTTCAACCTTGGTCTATTTTGTTGACATTTGTTTTTTCACTAATTTTCGATACAATGATGCTGCCAGGCTTGATG
TTTATTTTTCTTTTTTCGCCTTTGATAAAGCTGACTCAAGTCAATTTTTTATTTGAAGGTTTAGAAAATAGTATTCGTTG
GATAGCAAGTGTCTTTGGTAAACCAATCGTTTTTGGGCAGCCCAGTCCGCTTTTGCTGATTGTCATGTTACTTGTACTAG
CTATTTTGTACGATATTCGGCAAAATAAAAAGTGGGTAATATTTCTTAGTCTGTTTCTTTCATTACTATTTTTCATAAAT
AAATTTCCTTTGCAAAACGAGATCACAATGGTTGATGTTGGACAAGGAGATAGTATTTTTCTGAGAGACTGGAAAGGAAA
AAATGTATTGATTGATGTTGGCGGACGTGAGGAAATTAGAACAAAAGAAGCTTGGCAAAAACGAGCAACTAGCTCAAATG
CAGAGAAAACTTTGATTCCTTACCTAAAAAGTCGTGGCGTAGATACGATTGATACTTTAGTCTTAACAAATCCTAATCCA
GATTATGCAGGAGATGTATTAGGAGTTGCTAAAAAGTTTGCAATAAAGAAAATTTATATTTCCAGAAGTAGTCTAAGCAA
TGCAGATTTCCTAAAGAAATTAAGGGAGACAAATACATTCATTCATGTCATAAAACAAGGTGACAAACTTCCTATTTTTG
ATCATCATTTGCAAGTTCTTTCGGGTGCTAGCAAGAACGACCATTCGATTGTTTTATATGGTCAGTTTTTCCGTACAAGA
TTTTTATTTGCAAGCGATTTGAAAGAAGAAGAGGAAGCAAAGTTGATGCAACATTATCCAAAGTTGAAAACAGATATCTT
GAAAGTCGGGCAACATGGAGCTAAAAGTTCATCAAGTTCAAAGTTTTTGCAACAAATAGAACCAACGGTTGCGCTCATTT
CTGTTGGGAAAAATAATCAATCTAAGCAACCTAGTCAAGATACAATAGAGCGATTTGCACAATTGCCTGCTAAAGTCTAT
CGGACAGATGAACAAGGGGCAGTTAAATTTTCAGGGTGGACAAACTGGCGATTAGAGATGGTCAAGTAA
ATGTCACAGTGGATTAAAAGATTTCCGATTAAGCCGATTTACATTGCTTTTTTGCTCGTCTGGTTGTATTTTGCAATCTA
TCAAAGTAGCTGGTTAGGCTGGTTGGGTTTTATCTTTCTGGTGATTTGTCTTTTTCGCTTTTATTCACCGAAAGAATGTT
TCATGACCTTCATGATCCTCTCTTGTTTTGCTGGTTTTTTCTTTGTTCGTAGGGAAATAGCAGAGCAGAAGACGAAAGTA
GAACCTTCTCCCATAAGACAAGTGGCAGTTCTACCTGACACGATTAAGGTAAATGGTGATTCGCTTTCTTTTCGTGGTAA
AGCTAATAGGCAGACTTATCAAGTTTACTACAAATTGAAATCAAAGGAAGAACAGTTGGCTTTTCAAAATCTCTCTAGTC
TGGTTACATTGACCGTTGAAGGGGAATTTGAAATCCCTGAGAAGAAGCGTAATTTTGCTGGTTTTGATTACCAATCCTAT
TTAAAAACGCAAGGGATTTATCGAATTTTAAAAGTGGATACCATTTTATCGAGCCAAGATAGAATCAGCTTGCACCCTTT
TGAGTGGCTTTCTAGCTGGCGAAGAAAAGCACTGGTATTTATCAAGAACCATTTTCCAAATCCGATGAGTAATTACATGA
CAGGACTCTTATTTGGTGCCTTGGATACATCCTTTGACGAAATGAGCAATCTTTATTCTAGCTTGGGAATTATTCATTTA
TTTGCGCTGTCTGGCATGCAAGTTGGCTTTTTTATGGAGGGATTTCGCAAGTTACTGTTAAGGCTGGGGTTTACACAAGA
AATGGTTCGTAAATGCCAATATCCATTTTCTTTCTTTTATGCGGGAATGACTGGATTTTCAGTATCCGTTGTACGGAGCT
TAGTTCAGAAATTATTATCGCAACATGGTATCACTAAGTTAGATAATTTTGCTTTAACGATGATGATATTGTCCTTGATT
ATGCCGTCCTTTCTTTTGTCGGCAGGAGGAGTTCTCTCCTGTGCTTATGCTTTTGTCATTAGTGTGATAGATTTTGAAAG
TCTGACTTCTTGGCGAAAAGTTGTTGTAGAGAGTAGCGTTATTTCACTTGGTGTTTTACCAATTCTAATCTTTTACTTTG
GTGAATTTCAACCTTGGTCTATTTTGTTGACATTTGTTTTTTCACTAATTTTCGATACAATGATGCTGCCAGGCTTGATG
TTTATTTTTCTTTTTTCGCCTTTGATAAAGCTGACTCAAGTCAATTTTTTATTTGAAGGTTTAGAAAATAGTATTCGTTG
GATAGCAAGTGTCTTTGGTAAACCAATCGTTTTTGGGCAGCCCAGTCCGCTTTTGCTGATTGTCATGTTACTTGTACTAG
CTATTTTGTACGATATTCGGCAAAATAAAAAGTGGGTAATATTTCTTAGTCTGTTTCTTTCATTACTATTTTTCATAAAT
AAATTTCCTTTGCAAAACGAGATCACAATGGTTGATGTTGGACAAGGAGATAGTATTTTTCTGAGAGACTGGAAAGGAAA
AAATGTATTGATTGATGTTGGCGGACGTGAGGAAATTAGAACAAAAGAAGCTTGGCAAAAACGAGCAACTAGCTCAAATG
CAGAGAAAACTTTGATTCCTTACCTAAAAAGTCGTGGCGTAGATACGATTGATACTTTAGTCTTAACAAATCCTAATCCA
GATTATGCAGGAGATGTATTAGGAGTTGCTAAAAAGTTTGCAATAAAGAAAATTTATATTTCCAGAAGTAGTCTAAGCAA
TGCAGATTTCCTAAAGAAATTAAGGGAGACAAATACATTCATTCATGTCATAAAACAAGGTGACAAACTTCCTATTTTTG
ATCATCATTTGCAAGTTCTTTCGGGTGCTAGCAAGAACGACCATTCGATTGTTTTATATGGTCAGTTTTTCCGTACAAGA
TTTTTATTTGCAAGCGATTTGAAAGAAGAAGAGGAAGCAAAGTTGATGCAACATTATCCAAAGTTGAAAACAGATATCTT
GAAAGTCGGGCAACATGGAGCTAAAAGTTCATCAAGTTCAAAGTTTTTGCAACAAATAGAACCAACGGTTGCGCTCATTT
CTGTTGGGAAAAATAATCAATCTAAGCAACCTAGTCAAGATACAATAGAGCGATTTGCACAATTGCCTGCTAAAGTCTAT
CGGACAGATGAACAAGGGGCAGTTAAATTTTCAGGGTGGACAAACTGGCGATTAGAGATGGTCAAGTAA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comEC/celB | Streptococcus mitis SK321 |
54.618 |
100 |
0.55 |
| comEC/celB | Streptococcus mitis NCTC 12261 |
54.155 |
100 |
0.544 |
| comEC/celB | Streptococcus pneumoniae TIGR4 |
53.681 |
100 |
0.54 |
| comEC/celB | Streptococcus pneumoniae Rx1 |
52.878 |
100 |
0.532 |
| comEC/celB | Streptococcus pneumoniae D39 |
52.878 |
100 |
0.532 |
| comEC/celB | Streptococcus pneumoniae R6 |
52.878 |
100 |
0.532 |
| comEC | Lactococcus lactis subsp. cremoris KW2 |
46.774 |
100 |
0.469 |