Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   ETT52_RS05660 Genome accession   NZ_CP035447
Coordinates   1115129..1117372 (-) Length   747 a.a.
NCBI ID   WP_136040088.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain emm97.1     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1110129..1122372
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  ETT52_RS05630 (ETT52_05620) - 1110781..1112001 (+) 1221 WP_136026451.1 DUF3114 domain-containing protein -
  ETT52_RS09495 (ETT52_05625) - 1112115..1112973 (-) 859 Protein_1041 serine hydrolase -
  ETT52_RS05645 (ETT52_05635) - 1112922..1113149 (-) 228 WP_011054657.1 hypothetical protein -
  ETT52_RS05650 (ETT52_05640) sodA 1113316..1113921 (-) 606 WP_023612500.1 superoxide dismutase SodA -
  ETT52_RS05655 (ETT52_05645) holA 1114018..1115058 (-) 1041 WP_136040087.1 DNA polymerase III subunit delta -
  ETT52_RS05660 (ETT52_05650) comEC/celB 1115129..1117372 (-) 2244 WP_136040088.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  ETT52_RS05665 (ETT52_05655) - 1117353..1118015 (-) 663 WP_136026453.1 ComEA family DNA-binding protein -
  ETT52_RS05670 (ETT52_05660) - 1118215..1118955 (-) 741 WP_011054661.1 1-acyl-sn-glycerol-3-phosphate acyltransferase -
  ETT52_RS05675 (ETT52_05665) - 1119073..1119849 (+) 777 WP_010922438.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  ETT52_RS05680 (ETT52_05670) - 1119839..1120117 (+) 279 WP_136109113.1 GIY-YIG nuclease family protein -
  ETT52_RS05685 (ETT52_05675) - 1120141..1122141 (-) 2001 WP_136106694.1 potassium transporter Kup -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85607.51 Da        Isoelectric Point: 9.6593

>NTDB_id=302795 ETT52_RS05660 WP_136040088.1 1115129..1117372(-) (comEC/celB) [Streptococcus pyogenes strain emm97.1]
MTFSWTKLVPLSKIQFAFLILVFFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLTYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVSGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTALLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
IDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=302795 ETT52_RS05660 WP_136040088.1 1115129..1117372(-) (comEC/celB) [Streptococcus pyogenes strain emm97.1]
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTTTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGACTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGTTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTAGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCTAGTTTTAACCCAATGTCAATGGTCTTAACAGCTCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCGTTGGTGACTGTCTCAATATGCAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ATTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACACAAGGAGCTATTCGTTTGACTGGTTGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

46.051

100

0.461

  comEC/celB Streptococcus mitis NCTC 12261

45.845

99.866

0.458

  comEC/celB Streptococcus pneumoniae TIGR4

44.846

100

0.448

  comEC/celB Streptococcus pneumoniae Rx1

44.652

100

0.447

  comEC/celB Streptococcus pneumoniae D39

44.652

100

0.447

  comEC/celB Streptococcus pneumoniae R6

44.652

100

0.447

  comEC Lactococcus lactis subsp. cremoris KW2

41.35

95.181

0.394