Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   STAB904_RS05740 Genome accession   NZ_CP007241
Coordinates   1147828..1150071 (-) Length   747 a.a.
NCBI ID   WP_038434151.1    Uniprot ID   -
Organism   Streptococcus pyogenes strain 1E1     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1142828..1155071
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  STAB904_RS05710 (STAB904_06415) - 1143480..1144700 (+) 1221 WP_010922430.1 DUF3114 domain-containing protein -
  STAB904_RS05715 (STAB904_06420) - 1144814..1145636 (-) 823 Protein_1087 serine hydrolase -
  STAB904_RS05725 (STAB904_06430) - 1145621..1145848 (-) 228 WP_011054657.1 hypothetical protein -
  STAB904_RS05730 (STAB904_06435) sodA 1146015..1146620 (-) 606 WP_023612500.1 superoxide dismutase SodA -
  STAB904_RS05735 (STAB904_06440) holA 1146717..1147757 (-) 1041 WP_011888795.1 DNA polymerase III subunit delta -
  STAB904_RS05740 (STAB904_06445) comEC/celB 1147828..1150071 (-) 2244 WP_038434151.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  STAB904_RS05745 (STAB904_06450) - 1150052..1150714 (-) 663 WP_002983967.1 ComEA family DNA-binding protein -
  STAB904_RS05750 (STAB904_06455) - 1150914..1151654 (-) 741 WP_012560804.1 lysophospholipid acyltransferase family protein -
  STAB904_RS05755 (STAB904_06460) - 1151772..1152548 (+) 777 WP_010922438.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  STAB904_RS05760 (STAB904_06465) - 1152538..1152816 (+) 279 WP_002989164.1 GIY-YIG nuclease family protein -
  STAB904_RS05765 (STAB904_06470) - 1152840..1154840 (-) 2001 WP_038434152.1 potassium transporter Kup -

Sequence


Protein


Download         Length: 747 a.a.        Molecular weight: 85559.42 Da        Isoelectric Point: 9.6063

>NTDB_id=103520 STAB904_RS05740 WP_038434151.1 1147828..1150071(-) (comEC/celB) [Streptococcus pyogenes strain 1E1]
MTFSWTKLVPLSKIQFAFLILVLFYQIHSPSWLTFLLSLSLICLLVKRLSKKEFLGVFAILSFCALFLLYQKQQLIQKLE
IQPVQITSVALVPDSIRINGDQLAVLGRHGKHSYQLFYRLKSQAEAQLFKKEHRWLVMHAKVTLEKAEEVRNFKGFNYQT
FLAYQGIYRIGKVEQIEQLEVISPESICDYLSSLRRRAIVHCQQHFPRPMSHYLTDLLFGYLDKSFGEMTDYYSQLGIIH
LFALSGMQVGFFLTCFRRVLLLLAVPLEWIKWIELPFACFYAALTGYSISVIRSLVQSQLRHLGIKGLDNLACTFLLVFL
WDAHFLMTVGGVLTFSYAFLLTVVTVEELSGAKRQLVQVLTISLGILPFLLFYFSSFNPMSMVLTGLLSYLFDLFILPLL
CLVFCLSPLVTVSICNHLFILLEKVIQFLGNTFNSSLVFGSPTSWHLLILVISFAIFYDYRQVRQRVITCGLVIALTLLS
VKYPLTNEVTFIDIGQGDSILVREWTGKNLLIDVGGRPFFSSKEHWRRGHHVANAQKTLIPYLKSRGIHTIDQLLVTHAD
TDHMGDIEVVAKAIRIKEILTSQGSLSHPSFVRRLRRLKCHVRVLAAGDQLPIMGSVLQVLYPWQLGDGKNNDSLVLYGR
LLNRTFLFTGDLEKEGENEIIKRYPQLRVDYLKAGHHGSNTSSSAAFLDHIQPKVAFISAGKNNRYQHPHRETLARLEDR
QITYYRTDTQGAIRLTGWTSWHLETVR

Nucleotide


Download         Length: 2244 bp        

>NTDB_id=103520 STAB904_RS05740 WP_038434151.1 1147828..1150071(-) (comEC/celB) [Streptococcus pyogenes strain 1E1]
ATGACATTTTCTTGGACTAAGCTAGTGCCCCTGTCAAAGATTCAATTTGCTTTTTTAATCTTGGTTCTCTTTTATCAAAT
CCATAGCCCTAGCTGGTTAACGTTTCTCCTTAGCCTTAGTTTGATTTGCTTACTTGTCAAGCGTTTGTCTAAAAAAGAAT
TTCTTGGTGTCTTTGCCATCCTTAGTTTCTGTGCTTTGTTTTTGCTGTATCAGAAACAGCAGTTGATTCAAAAACTGGAA
ATTCAGCCAGTACAAATAACCTCTGTAGCATTAGTTCCTGATAGTATTCGGATTAATGGTGATCAATTAGCTGTTCTTGG
ACGTCACGGGAAACATTCTTATCAGTTATTTTACCGTTTGAAAAGCCAAGCAGAAGCCCAATTGTTCAAGAAAGAGCACC
GTTGGTTAGTGATGCACGCAAAAGTGACATTGGAAAAAGCTGAGGAAGTTCGAAATTTTAAAGGCTTTAATTATCAGACT
TTTTTGGCTTATCAAGGAATTTACAGGATAGGGAAGGTAGAGCAAATAGAACAGCTTGAAGTGATTTCACCCGAGTCAAT
ATGTGACTATTTGTCCTCTTTAAGACGACGAGCCATTGTTCATTGCCAGCAGCATTTTCCAAGACCTATGTCTCACTACC
TGACGGACCTCCTTTTTGGTTATTTAGATAAGTCGTTTGGTGAGATGACAGATTATTATAGTCAGTTGGGTATCATTCAT
CTCTTTGCTTTATCAGGGATGCAGGTTGGCTTCTTTCTTACTTGTTTTAGAAGGGTGTTGCTATTACTCGCAGTTCCTTT
GGAATGGATAAAATGGATAGAGCTTCCTTTTGCTTGCTTTTATGCCGCGTTGACAGGTTATAGTATTTCTGTTATTCGAA
GCCTCGTGCAGTCGCAGTTGCGTCATTTAGGAATAAAAGGATTAGACAATCTGGCTTGTACTTTTTTACTTGTCTTTTTA
TGGGATGCTCATTTCTTAATGACTGTTGGTGGCGTATTAACGTTTAGCTATGCTTTTTTGTTAACAGTGGTTACTGTTGA
AGAATTATCAGGAGCTAAAAGACAGTTGGTACAAGTCTTGACCATTTCCCTAGGAATATTACCATTTTTGCTCTTTTATT
TTTCTAGTTTTAACCCAATGTCAATGGTCTTAACAGGGCTCTTGTCTTATCTCTTTGACCTTTTTATTTTGCCCCTTCTT
TGTCTGGTTTTTTGTCTATCCCCTTTGGTGACTGTCTCAATATGTAACCATCTTTTTATTTTATTAGAAAAAGTCATTCA
ATTTCTCGGAAATACTTTCAATAGTTCCCTTGTTTTTGGAAGCCCGACCAGTTGGCACTTGCTTATCTTGGTGATTAGCT
TCGCTATTTTTTATGATTATCGGCAGGTGCGACAACGAGTTATCACTTGCGGTTTGGTTATAGCGTTGACGCTTTTGTCT
GTCAAATATCCTTTGACCAATGAAGTGACCTTTATCGACATTGGCCAGGGAGATAGTATTTTGGTGAGGGAGTGGACAGG
GAAAAATCTCTTAATAGATGTAGGTGGGCGCCCTTTCTTTTCTTCAAAAGAGCACTGGCGACGAGGACATCACGTAGCTA
ATGCTCAGAAAACCTTAATTCCTTACTTAAAAAGTAGAGGTATTCACACAATTGACCAACTATTAGTAACTCACGCAGAT
ACTGATCATATGGGGGATATCGAAGTGGTTGCCAAAGCTATTCGGATAAAGGAGATTTTGACTAGTCAAGGCAGTTTAAG
CCATCCAAGCTTTGTTAGGCGGCTAAGGCGTTTAAAATGTCACGTTAGGGTTTTAGCAGCTGGAGACCAGTTGCCTATTA
TGGGAAGTGTCTTACAGGTACTCTACCCTTGGCAGTTAGGGGACGGGAAAAATAACGATTCTTTGGTACTTTATGGCAGG
CTCTTAAATCGAACTTTTCTTTTCACAGGTGACTTGGAAAAAGAGGGGGAAAACGAGATCATAAAACGTTATCCTCAACT
AAGAGTAGATTATTTAAAAGCAGGTCACCATGGATCAAATACCTCTTCTAGTGCAGCTTTTTTAGACCATATTCAACCTA
AAGTGGCCTTTATTTCTGCTGGAAAAAATAACCGTTATCAGCATCCTCACAGAGAAACCTTAGCCCGTTTGGAAGACAGA
CAAATTACTTATTACCGAACGGATACGCAAGGAGCTATTCGTTTGACTGGTTGGACAAGCTGGCATCTTGAAACGGTCCG
TTAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis SK321

46.185

100

0.462

  comEC/celB Streptococcus mitis NCTC 12261

45.979

99.866

0.459

  comEC/celB Streptococcus pneumoniae TIGR4

44.98

100

0.45

  comEC/celB Streptococcus pneumoniae Rx1

44.786

100

0.448

  comEC/celB Streptococcus pneumoniae D39

44.786

100

0.448

  comEC/celB Streptococcus pneumoniae R6

44.786

100

0.448

  comEC Lactococcus lactis subsp. cremoris KW2

40.537

99.732

0.404


Multiple sequence alignment