Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   GGS_RS06965 Genome accession   NC_018712
Coordinates   1418041..1420284 (-) Length   747 a.a.
NCBI ID   WP_015017202.1    Uniprot ID   -
Organism   Streptococcus dysgalactiae subsp. equisimilis RE378     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1413041..1425284
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GGS_RS06945 (GGS_1317) - 1413649..1414869 (+) 1221 WP_015017200.1 DUF3114 domain-containing protein -
  GGS_RS06950 (GGS_1318) - 1414990..1416052 (-) 1063 Protein_1338 serine hydrolase -
  GGS_RS06955 (GGS_1319) sodA 1416219..1416824 (-) 606 WP_003054499.1 superoxide dismutase SodA -
  GGS_RS06960 (GGS_1320) holA 1416914..1417960 (-) 1047 WP_015017201.1 DNA polymerase III subunit delta -
  GGS_RS06965 (GGS_1321) comEC/celB 1418041..1420284 (-) 2244 WP_015017202.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  GGS_RS06970 (GGS_1322) comEA 1420265..1420927 (-) 663 WP_003057999.1 helix-hairpin-helix domain-containing protein Machinery gene
  GGS_RS06975 (GGS_1323) - 1421324..1422064 (-) 741 WP_003062277.1 1-acyl-sn-glycerol-3-phosphate acyltransferase -
  GGS_RS06980 (GGS_1324) - 1422182..1422958 (+) 777 WP_148275174.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  GGS_RS06985 - 1422948..1423226 (+) 279 WP_003061674.1 GIY-YIG nuclease family protein -
  GGS_RS06990 (GGS_1325) - 1423250..1425250 (-) 2001 WP_003061221.1 potassium transporter Kup -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85150.67 Da        Isoelectric Point: 9.2618

>NTDB_id=44917 GGS_RS06965 WP_015017202.1 1418041..1420284(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis RE378]
MNYRWTKWSPLPPIQLAFLVMALYYQIYCPSWLTCLLSSCLGMLLLKQFPQKTLCKVVMILALFAAVFVYRKHQLRQQLE
TQPLQVSQVALVPDSIRINGDQLAVIGRHGNHSYQLFYHFKHQTEARFFQKEYRWIVMHAKIVLDKAETSRNFRGFNYQS
FLAYQGIYRIGKVEQVEQLEVVSPKSVGDYLSSLRRQAIVHCQQSFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRGLTLLAIPLEWIKWIELPFACLYAALTGYSISVIRSLLQAQLGHLGIKGLDNLACAFLLVLL
WDAHALMTVGGVLTFSYAFMLTIITFEELSGVKKHFVQVITVSLGMLPFLLFYFASFNPMSMVLTELLSYLFDVLILPLL
CLVFCLSPLITLSGCNYLFLFLEKVIQFLGNTLNASLVFGSPTSWHLLILVISFAILYDHRKIRQRVITCGLVIGLTLLS
VKYPLTNEVTFIDIGQGDSILVRDWTGKNLLIDVGGRLSFSSKEQWRQGHQTSNAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSQPSFVRRLRGLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGNGKNNDSLVLYGR
LLNQTFLFTGDLEKEGENEIIERYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLTRLEDR
EISYYRTDIQGAVRLTGWLNWHIETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=44917 GGS_RS06965 WP_015017202.1 1418041..1420284(-) (comEC/celB) [Streptococcus dysgalactiae subsp. equisimilis RE378]
ATGAACTATCGTTGGACTAAGTGGTCTCCCTTGCCTCCCATTCAACTAGCCTTTTTGGTAATGGCTCTTTATTATCAGAT
CTATTGTCCTAGCTGGTTGACTTGCTTACTTAGCAGTTGTTTAGGAATGTTACTATTGAAGCAGTTTCCTCAGAAGACCC
TCTGTAAGGTTGTTATGATTCTGGCCTTATTTGCTGCTGTCTTTGTTTATCGGAAACATCAGTTGAGACAGCAATTGGAA
ACACAACCTTTACAAGTGTCTCAGGTAGCATTAGTTCCTGATAGTATTCGAATTAATGGAGATCAATTAGCTGTTATTGG
GCGTCACGGTAATCATTCTTATCAGTTGTTTTATCATTTTAAACATCAAACGGAAGCCCGATTTTTCCAAAAAGAGTACC
GTTGGATAGTGATGCATGCCAAAATAGTATTGGACAAGGCTGAGACTTCCCGAAATTTTAGAGGATTTAATTACCAATCT
TTTTTAGCCTATCAGGGAATTTACAGGATAGGAAAAGTGGAACAAGTAGAGCAGCTTGAAGTGGTTTCACCAAAGTCAGT
AGGAGATTATTTATCTTCTTTGAGGCGACAGGCTATTGTCCATTGCCAACAATCCTTTCCAAAGCCCATGTCTCATTATT
TGACGGGACTCCTTTTCGGCTATTTGGATAAGTCCTTTGGTGAGATGACAGATTATTATAGTCAGCTTGGTATCATTCAT
CTTTTTGCCCTATCAGGGATGCAGGTTGGCTTCTTTTTAACCTGTTTTAGAAGAGGTTTGACGCTATTAGCTATTCCTCT
CGAATGGATTAAATGGATAGAGCTTCCCTTTGCCTGTCTATATGCTGCGCTGACAGGTTACAGTATTTCTGTTATTCGAA
GCCTTCTGCAGGCCCAATTAGGTCATCTAGGCATAAAAGGCTTAGATAATCTGGCTTGCGCTTTCTTACTTGTTCTTTTA
TGGGATGCTCATGCTTTGATGACTGTTGGTGGAGTACTAACATTTAGCTATGCGTTTATGTTAACTATTATCACTTTTGA
GGAGTTATCGGGAGTTAAAAAGCATTTCGTCCAGGTCATTACTGTTTCTTTAGGGATGTTACCTTTCTTGCTCTTTTATT
TTGCTAGTTTTAACCCCATGTCAATGGTATTGACAGAGCTTTTGTCTTATCTCTTCGATGTTTTGATTTTGCCTCTTCTT
TGCTTGGTTTTCTGTTTGTCTCCTTTGATAACTCTCTCAGGATGTAATTATCTCTTTCTTTTCTTAGAAAAAGTCATTCA
ATTTCTTGGGAATACCCTCAATGCCTCCCTTGTTTTTGGAAGTCCGACCAGTTGGCACTTGCTTATCCTGGTGATTAGCT
TCGCTATTCTTTATGACCATCGGAAGATACGACAAAGAGTTATCACTTGCGGCTTGGTCATAGGCCTGACGCTTTTATCT
GTTAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGCGATAGTATTTTAGTGAGGGATTGGACAGG
AAAAAATCTCTTAATAGATGTAGGTGGGCGCCTTTCCTTTTCTTCAAAAGAGCAGTGGCGACAGGGGCACCAGACATCGA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGCATTCACACCATTGACCAATTACTAGTGACTCATGCGGAT
ACTGATCATATGGGGGATATAGAGGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGCCAAGGTAGTTTAAG
CCAGCCAAGCTTTGTTAGGCGGTTAAGGGGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAATTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTATCCTTGGCAGTTAGGGAACGGGAAAAATAATGATTCTCTGGTTCTTTATGGTAGG
CTCCTCAATCAAACTTTTCTATTTACAGGTGATTTGGAAAAAGAGGGAGAAAACGAAATCATAGAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAGCCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCCTAACCCGTTTAGAGGATAGG
GAAATTTCTTATTATCGCACGGATATTCAAGGAGCTGTTCGGTTGACAGGATGGCTAAATTGGCATATTGAGACTGTTCG
TTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

45.772

99.732

0.456

  comEC/celB Streptococcus mitis NCTC 12261

45.71

99.866

0.456

  comEC/celB Streptococcus pneumoniae TIGR4

45.187

100

0.452

  comEC/celB Streptococcus pneumoniae Rx1

44.92

100

0.45

  comEC/celB Streptococcus pneumoniae D39

44.92

100

0.45

  comEC/celB Streptococcus pneumoniae R6

44.92

100

0.45

  comEC Lactococcus lactis subsp. cremoris KW2

41.588

99.465

0.414


Multiple sequence alignment