Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   DQM44_RS06870 Genome accession   NZ_LS483318
Coordinates   1337234..1339477 (-) Length   747 a.a.
NCBI ID   WP_044565459.1    Uniprot ID   -
Organism   Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1332234..1344477
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  DQM44_RS06850 (NCTC5370_01416) - 1332843..1334063 (+) 1221 WP_015017200.1 DUF3114 domain-containing protein -
  DQM44_RS06855 (NCTC5370_01417) - 1334184..1335245 (-) 1062 WP_046166020.1 serine hydrolase -
  DQM44_RS06860 (NCTC5370_01418) sodA 1335412..1336017 (-) 606 WP_014612432.1 superoxide dismutase SodA -
  DQM44_RS06865 (NCTC5370_01419) holA 1336107..1337153 (-) 1047 WP_046166021.1 DNA polymerase III subunit delta -
  DQM44_RS06870 (NCTC5370_01420) comEC/celB 1337234..1339477 (-) 2244 WP_044565459.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  DQM44_RS06875 (NCTC5370_01421) comEA 1339458..1340120 (-) 663 WP_003057999.1 helix-hairpin-helix domain-containing protein Machinery gene
  DQM44_RS06880 (NCTC5370_01422) - 1340517..1341257 (-) 741 WP_022554937.1 1-acyl-sn-glycerol-3-phosphate acyltransferase -
  DQM44_RS06885 (NCTC5370_01423) - 1341375..1342151 (+) 777 WP_080286812.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  DQM44_RS06890 (NCTC5370_01424) - 1342141..1342419 (+) 279 WP_003061674.1 GIY-YIG nuclease family protein -
  DQM44_RS06895 (NCTC5370_01425) - 1342443..1344443 (-) 2001 WP_022554940.1 potassium transporter Kup -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 84997.50 Da        Isoelectric Point: 9.4078

>NTDB_id=1016735 DQM44_RS06870 WP_044565459.1 1337234..1339477(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=1016735 DQM44_RS06870 WP_044565459.1 1337234..1339477(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis strain NCTC5370]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTGGTTCCGGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCCAGTTTTAACCCCATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGATATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGAACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGATTTGGAAAAAGAGGGAGAAAACGAGATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis NCTC 12261

46.247

99.866

0.462

  comEC/celB Streptococcus mitis SK321

46.309

99.732

0.462

  comEC/celB Streptococcus pneumoniae TIGR4

45.722

100

0.458

  comEC/celB Streptococcus pneumoniae Rx1

45.455

100

0.455

  comEC/celB Streptococcus pneumoniae D39

45.455

100

0.455

  comEC/celB Streptococcus pneumoniae R6

45.455

100

0.455

  comEC Lactococcus lactis subsp. cremoris KW2

41.398

99.598

0.412


Multiple sequence alignment