Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   STR1_RS07385 Genome accession   NZ_CP065486
Coordinates   1441296..1443536 (-) Length   746 a.a.
NCBI ID   WP_011681495.1    Uniprot ID   -
Organism   Streptococcus thermophilus strain R1     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1436296..1448536
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  STR1_RS07365 (STR1_07420) - 1437160..1438020 (-) 861 WP_011226395.1 methionyl aminopeptidase -
  STR1_RS07370 (STR1_07425) spxR 1438064..1439344 (-) 1281 WP_014608610.1 CBS-HotDog domain-containing transcription factor SpxR -
  STR1_RS07375 (STR1_07430) - 1439337..1439882 (-) 546 WP_014608611.1 GNAT family N-acetyltransferase -
  STR1_RS07380 (STR1_07435) - 1439948..1441210 (-) 1263 WP_095559426.1 UDP-N-acetylglucosamine 1-carboxyvinyltransferase -
  STR1_RS07385 (STR1_07440) comEC/celB 1441296..1443536 (-) 2241 WP_011681495.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  STR1_RS07390 (STR1_07445) comEA 1443526..1444221 (-) 696 WP_023909867.1 helix-hairpin-helix domain-containing protein Machinery gene
  STR1_RS07395 (STR1_07450) - 1444329..1445084 (-) 756 WP_011681497.1 1-acyl-sn-glycerol-3-phosphate acyltransferase -
  STR1_RS07400 (STR1_07455) - 1445284..1446150 (+) 867 WP_014621873.1 polysaccharide deacetylase family protein -
  STR1_RS07405 (STR1_07460) - 1446200..1446964 (+) 765 WP_011681498.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  STR1_RS07410 (STR1_07465) - 1446968..1447237 (+) 270 WP_011226404.1 GIY-YIG nuclease family protein -

Sequence


Protein


Download         Length: 746 a.a.        Molecular weight: 84759.76 Da        Isoelectric Point: 9.9562

>NTDB_id=448342 STR1_RS07385 WP_011681495.1 1441296..1443536(-) (comEC/celB) [Streptococcus thermophilus strain R1]
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
APAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYRLKSDKEQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRITQIERLEHVVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTSQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNPLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKKKWQEGSQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLEVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMASYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR

Nucleotide


Download         Length: 2241 bp        

>NTDB_id=448342 STR1_RS07385 WP_011681495.1 1441296..1443536(-) (comEC/celB) [Streptococcus thermophilus strain R1]
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
GCTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCGGCTAAAATCTGATAAGGAGCAGCATTTTTTTAAGACTACGAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTACTCAGATTGAGCGTCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCAGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTCTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAATCCACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
GACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGAAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTAGAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTGTTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGGCTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGACCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis NCTC 12261

47.587

100

0.476

  comEC/celB Streptococcus mitis SK321

46.72

100

0.468

  comEC/celB Streptococcus pneumoniae TIGR4

46.051

100

0.461

  comEC/celB Streptococcus pneumoniae D39

45.783

100

0.458

  comEC/celB Streptococcus pneumoniae Rx1

45.783

100

0.458

  comEC/celB Streptococcus pneumoniae R6

45.783

100

0.458

  comEC Lactococcus lactis subsp. cremoris KW2

44.966

97.185

0.437