Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   SDEG_RS07105 Genome accession   NC_012891
Coordinates   1401868..1404111 (-) Length   747 a.a.
NCBI ID   WP_012767256.1    Uniprot ID   -
Organism   Streptococcus dysgalactiae subsp. equisimilis GGS_124     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1396868..1409111
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  SDEG_RS07085 (SDEG_1445) - 1397476..1398696 (+) 1221 WP_003056368.1 DUF3114 domain-containing protein -
  SDEG_RS07090 (SDEG_1446) - 1398817..1399878 (-) 1062 WP_012767255.1 serine hydrolase -
  SDEG_RS07095 (SDEG_1447) sodA 1400045..1400650 (-) 606 WP_003054499.1 superoxide dismutase SodA -
  SDEG_RS07100 (SDEG_1448) holA 1400747..1401787 (-) 1041 WP_003054496.1 DNA polymerase III subunit delta -
  SDEG_RS07105 (SDEG_1449) comEC/celB 1401868..1404111 (-) 2244 WP_012767256.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  SDEG_RS07110 (SDEG_1450) - 1404092..1404754 (-) 663 WP_012767257.1 helix-hairpin-helix domain-containing protein -
  SDEG_RS07115 (SDEG_1451) - 1405151..1405891 (-) 741 WP_003062277.1 lysophospholipid acyltransferase family protein -
  SDEG_RS07120 (SDEG_1452) - 1406009..1406785 (+) 777 WP_143606092.1 methyltransferase -
  SDEG_RS07125 (SDEG_1453) - 1406775..1407053 (+) 279 WP_003061674.1 GIY-YIG nuclease family protein -
  SDEG_RS07130 (SDEG_1454) - 1407077..1409077 (-) 2001 WP_012767260.1 KUP/HAK/KT family potassium transporter -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85099.58 Da        Isoelectric Point: 9.2617

>NTDB_id=30685 SDEG_RS07105 WP_012767256.1 1401868..1404111(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis GGS_124]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAGFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGQQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=30685 SDEG_RS07105 WP_012767256.1 1401868..1404111(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis GGS_124]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGGCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGTTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTATCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGTAATACCCTAAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCAACAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

45.772

99.732

0.456

  comEC/celB Streptococcus mitis NCTC 12261

45.71

99.866

0.456

  comEC/celB Streptococcus pneumoniae TIGR4

45.187

100

0.452

  comEC/celB Streptococcus pneumoniae Rx1

44.92

100

0.45

  comEC/celB Streptococcus pneumoniae D39

44.92

100

0.45

  comEC/celB Streptococcus pneumoniae R6

44.92

100

0.45

  comEC Lactococcus lactis subsp. cremoris KW2

41.723

99.465

0.415


Multiple sequence alignment