Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   H1W95_RS07415 Genome accession   NZ_LR822030
Coordinates   1444302..1446542 (-) Length   746 a.a.
NCBI ID   WP_180483363.1    Uniprot ID   -
Organism   Streptococcus thermophilus isolate STH_CIRM_1046     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1439302..1451542
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  H1W95_RS07395 (STHERMO_1668) - 1440166..1441026 (-) 861 WP_002951571.1 methionyl aminopeptidase -
  H1W95_RS07400 (STHERMO_1669) spxR 1441070..1442350 (-) 1281 WP_084826098.1 CBS-HotDog domain-containing transcription factor SpxR -
  H1W95_RS07405 (STHERMO_1670) - 1442343..1442888 (-) 546 WP_014608611.1 GNAT family N-acetyltransferase -
  H1W95_RS07410 (STHERMO_1671) - 1442954..1444216 (-) 1263 WP_180483361.1 UDP-N-acetylglucosamine 1-carboxyvinyltransferase -
  H1W95_RS07415 (STHERMO_1672) comEC/celB 1444302..1446542 (-) 2241 WP_180483363.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  H1W95_RS07420 (STHERMO_1673) comEA 1446532..1447227 (-) 696 WP_014608614.1 helix-hairpin-helix domain-containing protein Machinery gene
  H1W95_RS07425 (STHERMO_1674) - 1447335..1448090 (-) 756 WP_002948862.1 lysophospholipid acyltransferase family protein -
  H1W95_RS07430 (STHERMO_1675) - 1448279..1449154 (+) 876 WP_311316720.1 polysaccharide deacetylase family protein -
  H1W95_RS07435 (STHERMO_1676) - 1449204..1449968 (+) 765 WP_180483365.1 tRNA1(Val) (adenine(37)-N6)-methyltransferase -
  H1W95_RS07440 (STHERMO_1677) - 1449972..1450241 (+) 270 WP_011226404.1 GIY-YIG nuclease family protein -

Sequence


Protein


Download         Length: 746 a.a.        Molecular weight: 84821.73 Da        Isoelectric Point: 9.9284

>NTDB_id=1010634 H1W95_RS07415 WP_180483363.1 1444302..1446542(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_1046]
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLVICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYRLKSDREQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHAVTPKSISPIAFFHQLRRKALVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMPSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQPLILGKPSLFQFVSMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKEKWQEGSQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFLKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMTSYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR

Nucleotide


Download         Length: 2241 bp        

>NTDB_id=1010634 H1W95_RS07415 WP_180483363.1 1444302..1446542(-) (comEC/celB) [Streptococcus thermophilus isolate STH_CIRM_1046]
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGGTGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGGAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCGGCTAAAATCTGATAGGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGCTTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGTCTGGAACATGCCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGGCTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTACTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGCCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGCCATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGGAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTCTTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTATTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGACTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGATCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis NCTC 12261

47.721

100

0.477

  comEC/celB Streptococcus mitis SK321

46.854

100

0.469

  comEC/celB Streptococcus pneumoniae TIGR4

45.917

100

0.46

  comEC/celB Streptococcus pneumoniae D39

45.649

100

0.457

  comEC/celB Streptococcus pneumoniae Rx1

45.649

100

0.457

  comEC/celB Streptococcus pneumoniae R6

45.649

100

0.457

  comEC Lactococcus lactis subsp. cremoris KW2

44.966

97.185

0.437