Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   GE022_RS02685 Genome accession   NZ_CP053790
Coordinates   530921..533164 (+) Length   747 a.a.
NCBI ID   WP_164405773.1    Uniprot ID   -
Organism   Streptococcus canis strain HL_77_2     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 525921..538164
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GE022_RS02660 (GE022_002645) - 526044..528044 (+) 2001 WP_164405776.1 potassium transporter Kup -
  GE022_RS02665 (GE022_002650) - 528173..528451 (-) 279 WP_003044201.1 GIY-YIG nuclease family protein -
  GE022_RS02670 (GE022_002655) - 528441..529217 (-) 777 WP_159304866.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  GE022_RS02675 (GE022_002660) - 529335..530075 (+) 741 WP_164405775.1 lysophospholipid acyltransferase family protein -
  GE022_RS02680 (GE022_002665) comEA 530278..530940 (+) 663 WP_164405774.1 ComEA family DNA-binding protein Machinery gene
  GE022_RS02685 (GE022_002670) comEC/celB 530921..533164 (+) 2244 WP_164405773.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  GE022_RS02690 (GE022_002675) holA 533244..534284 (+) 1041 WP_164405772.1 DNA polymerase III subunit delta -
  GE022_RS02695 (GE022_002680) sodA 534381..534986 (+) 606 WP_003044189.1 superoxide dismutase SodA -
  GE022_RS02700 (GE022_002685) - 535200..536213 (+) 1014 WP_420853618.1 serine hydrolase -
  GE022_RS02705 (GE022_002690) - 536327..537547 (-) 1221 WP_164405771.1 DUF3114 domain-containing protein -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85113.01 Da        Isoelectric Point: 9.7278

>NTDB_id=394499 GE022_RS02685 WP_164405773.1 530921..533164(+) (comEC/celB) [Streptococcus canis strain HL_77_2]
MTFSWTKLLPLPKIQLAFLVLVLFYHIYSPSWLTSLLSLGLICLLVKRLSKREFLSVFALLSLCALFLLYQKQQLTQELE
TQPLQITSVELIPDSIRINGDQLAVIGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVLHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQMEQLEVSSPKSVFDYLSSLRRQAIVHCQQHFPKPMSHYLTGLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTYFRRLLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFMLTIVTVEELSGAKRQLVQALIISLGMLPLLLFYFSSFNPMSIILTGLLSYLFDVLILPLL
CLVFCLSPLVTVSVCNHLFLLLEKGIQFLGNTVNTSLVFGSPTSWQLLLIVLSFAILYDYRQVRQRVFACGLVIALTLLS
VKYPLTNEVTIVDIGQGDSILIRDWRGKTLLIDVGGRPTFSKKEKWRSGYQTANAQKTLIPYLKSRGIHKIDQLLLTHTD
ADHMGDMEVVAKAIRVKEVLTSQGSLTNPSAVQRLNRLKCQVKVVKAGDQLSIMGSTLQVLYPWKLGDGKNNDSLVLYGK
LLNRTFLFTGDLEKEGEVEIIKRYPQLRVDYLKAGHHGSNTSSSAVFLDHLQPKLAFISAGKNNRYHHPSKETLTRLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=394499 GE022_RS02685 WP_164405773.1 530921..533164(+) (comEC/celB) [Streptococcus canis strain HL_77_2]
ATGACATTTTCTTGGACTAAGCTATTGCCCCTGCCAAAGATTCAATTAGCTTTTTTGGTTTTGGTTCTCTTTTATCACAT
TTATAGTCCTAGCTGGTTAACTTCTCTTCTTAGCCTTGGTTTGATTTGCTTACTTGTAAAGCGTTTGTCTAAAAGAGAAT
TTCTCAGTGTCTTTGCCCTCCTTAGTTTATGTGCTTTGTTCTTACTCTATCAGAAACAACAGCTGACTCAAGAACTGGAG
ACTCAGCCATTACAAATAACCTCTGTAGAATTGATTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTATTGG
ACGTCATGGGAAACACTCCTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAAAAAGAACATC
GTTGGTTAGTGCTGCACGCAAAAGTGACCTTGGAAAAAGCTGAGGAAGTTCGCAATTTTAAAGGATTTAATTACCAGACT
TTTTTGGCTTATCAGGGAATTTACAGGATAGGGAAGGTAGAGCAAATGGAACAGCTTGAAGTGAGCTCTCCAAAGTCAGT
GTTTGATTACTTGTCTTCCTTAAGACGGCAGGCCATTGTCCATTGTCAACAGCATTTTCCTAAACCCATGTCTCACTACC
TGACAGGTCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGCCAGCTGGGCATCATTCAT
CTCTTTGCCTTATCAGGGATGCAGGTTGGTTTCTTTCTCACTTATTTTAGAAGGTTGTTGCTATTACTAGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGCTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGCATAAAAGGTTTAGACAATCTCGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCCCATTTCTTAATGACTGTTGGTGGGGTATTAACATTTAGCTATGCTTTTATGTTAACAATAGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGCGCTAATTATCTCCCTAGGAATGTTACCGTTACTGCTGTTTTATT
TTTCCAGTTTTAATCCGATGTCAATAATATTAACAGGTCTCTTGTCTTACCTCTTTGACGTTTTGATTTTGCCTCTTCTT
TGTCTGGTTTTCTGTCTATCCCCTTTGGTGACTGTCTCAGTATGCAATCATCTCTTTCTTTTATTAGAAAAGGGGATTCA
ATTTCTTGGAAATACTGTCAATACTTCCCTTGTTTTTGGAAGTCCAACTAGTTGGCAATTACTTCTTATAGTGCTCAGCT
TTGCGATTCTTTATGACTATCGACAGGTGCGACAAAGGGTCTTCGCTTGTGGATTGGTCATAGCATTGACCTTACTGTCT
GTCAAATACCCTTTGACAAATGAAGTCACTATCGTTGATATTGGACAAGGAGATAGTATTTTGATAAGGGATTGGCGAGG
AAAGACACTCTTGATAGACGTTGGAGGACGTCCAACCTTTTCTAAAAAGGAGAAATGGCGCAGCGGTTATCAGACGGCGA
ATGCCCAAAAAACCTTAATCCCTTATTTAAAAAGCAGAGGCATTCATAAAATTGATCAGTTATTACTAACTCATACGGAT
GCTGATCACATGGGAGATATGGAAGTGGTTGCCAAAGCCATTCGAGTGAAGGAAGTGTTAACTAGCCAAGGTAGTTTAAC
GAACCCAAGTGCTGTGCAACGTTTAAACCGTTTAAAATGTCAGGTTAAGGTTGTTAAAGCTGGCGACCAGTTGTCCATTA
TGGGAAGCACCTTGCAGGTCCTCTATCCTTGGAAACTAGGAGATGGAAAAAATAATGATTCTTTGGTCCTCTATGGCAAG
CTATTAAATCGAACTTTTCTTTTCACAGGGGACTTGGAAAAAGAAGGAGAAGTTGAGATTATCAAACGTTATCCCCAGTT
AAGGGTGGATTATTTGAAAGCTGGCCATCATGGGTCAAATACTTCTTCAAGTGCAGTTTTTTTAGACCATCTTCAGCCCA
AGCTTGCTTTTATTTCTGCAGGAAAGAATAATCGGTACCACCATCCTAGTAAAGAGACCTTAACACGTTTGGAAGACAGA
CAAATCACGTATTATCGAACTGATACTCAAGGAGCTATTCGTTTGACTGGTTGGACCAGCTGGCATCTTGAAACGGTCCG
TTAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

47.059

100

0.471

  comEC/celB Streptococcus mitis NCTC 12261

46.917

99.866

0.469

  comEC/celB Streptococcus pneumoniae Rx1

45.455

100

0.455

  comEC/celB Streptococcus pneumoniae D39

45.455

100

0.455

  comEC/celB Streptococcus pneumoniae R6

45.455

100

0.455

  comEC/celB Streptococcus pneumoniae TIGR4

45.515

100

0.455

  comEC Lactococcus lactis subsp. cremoris KW2

42.148

99.732

0.42


Multiple sequence alignment