Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   ETT50_RS03610 Genome accession   NZ_CP035449
Coordinates   678735..680978 (+) Length   747 a.a.
NCBI ID   WP_032465085.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain emm56     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 673735..685978
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  ETT50_RS03585 (ETT50_03585) - 673967..675967 (+) 2001 WP_032465086.1 potassium transporter Kup -
  ETT50_RS03590 (ETT50_03590) - 675990..676268 (-) 279 WP_002989164.1 GIY-YIG nuclease family protein -
  ETT50_RS03595 (ETT50_03595) - 676258..677034 (-) 777 WP_010922438.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  ETT50_RS03600 (ETT50_03600) - 677152..677892 (+) 741 WP_002989170.1 1-acyl-sn-glycerol-3-phosphate acyltransferase -
  ETT50_RS03605 (ETT50_03605) - 678092..678754 (+) 663 WP_002983967.1 ComEA family DNA-binding protein -
  ETT50_RS03610 (ETT50_03610) comEC/celB 678735..680978 (+) 2244 WP_032465085.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  ETT50_RS03615 (ETT50_03615) holA 681049..682089 (+) 1041 WP_011888795.1 DNA polymerase III subunit delta -
  ETT50_RS03620 (ETT50_03620) sodA 682186..682791 (+) 606 WP_032465084.1 superoxide dismutase SodA -
  ETT50_RS09660 - 682958..684006 (+) 1049 Protein_639 serine hydrolase -
  ETT50_RS03640 (ETT50_03640) - 684120..685340 (-) 1221 WP_030126414.1 DUF3114 domain-containing protein -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85551.40 Da        Isoelectric Point: 9.6593

>NTDB_id=302983 ETT50_RS03610 WP_032465085.1 678735..680978(+) (comEC/celB) [Streptococcus pyogenes strain emm56]
MTFSWTKLVPLSKIQFAFLILVFFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLVQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLTYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=302983 ETT50_RS03610 WP_032465085.1 678735..680978(+) (comEC/celB) [Streptococcus pyogenes strain emm56]
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTTTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTCGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGGTTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCATGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGACTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGGCCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTCACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTTGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACACAAGGAGCTATTCGTTTGACTGGTTGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

46.185

100

0.462

  comEC/celB Streptococcus mitis NCTC 12261

45.979

99.866

0.459

  comEC/celB Streptococcus pneumoniae TIGR4

44.98

100

0.45

  comEC/celB Streptococcus pneumoniae Rx1

44.786

100

0.448

  comEC/celB Streptococcus pneumoniae D39

44.786

100

0.448

  comEC/celB Streptococcus pneumoniae R6

44.786

100

0.448

  comEC Lactococcus lactis subsp. cremoris KW2

41.491

95.181

0.395


Multiple sequence alignment