Detailed information    

insolico Bioinformatically predicted

Overview


Name   comEC/celB   Type   Machinery gene
Locus tag   GQY29_RS05600 Genome accession   NZ_CP047191
Coordinates   1037193..1039433 (+) Length   746 a.a.
NCBI ID   WP_159341007.1    Uniprot ID   -
Organism   Streptococcus thermophilus strain EU01     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1032193..1044433
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GQY29_RS05575 (GQY29_05575) - 1032522..1032785 (-) 264 WP_014621867.1 hypothetical protein -
  GQY29_RS05580 (GQY29_05580) - 1032772..1033857 (-) 1086 WP_023909868.1 radical SAM/SPASM domain-containing protein -
  GQY29_RS05585 (GQY29_05585) - 1033847..1034917 (-) 1071 WP_041829155.1 radical SAM protein -
  GQY29_RS05590 (GQY29_05590) - 1035266..1036138 (-) 873 WP_014621863.1 Rgg/GadR/MutR family transcriptional regulator -
  GQY29_RS05595 (GQY29_05595) comEA 1036508..1037203 (+) 696 WP_014621862.1 helix-hairpin-helix domain-containing protein Machinery gene
  GQY29_RS05600 (GQY29_05600) comEC/celB 1037193..1039433 (+) 2241 WP_159341007.1 DNA internalization-related competence protein ComEC/Rec2 Machinery gene
  GQY29_RS05605 (GQY29_05605) - 1039519..1040781 (+) 1263 WP_014608612.1 UDP-N-acetylglucosamine 1-carboxyvinyltransferase -
  GQY29_RS05610 (GQY29_05610) - 1040847..1041392 (+) 546 WP_014608611.1 GNAT family N-acetyltransferase -
  GQY29_RS05615 (GQY29_05615) spxR 1041385..1042665 (+) 1281 WP_014608610.1 CBS-HotDog domain-containing transcription factor SpxR -
  GQY29_RS05620 (GQY29_05620) - 1042709..1043569 (+) 861 WP_011226395.1 methionyl aminopeptidase -

Sequence


Protein


Download         Length: 746 a.a.        Molecular weight: 84874.85 Da        Isoelectric Point: 9.9961

>NTDB_id=357914 GQY29_RS05600 WP_159341007.1 1037193..1039433(+) (comEC/celB) [Streptococcus thermophilus strain EU01]
MWLKKAPINLFSLALLIVALYFTIFVSNFYAIGTFVFLMICFLRHHWKNRAALKLVGLIGGFFLVYFLFLYHIAIMQDKQ
TPAEIHQVTLVADTLSVNGERLSAIGKSNGQTYQVFYRLKSDREQHFFKTTSQTLVLKGKIKLSSATGQRNFQGFDYQSY
LASQGIYRIAQIERLEHVVTPKSISPIAFFHQLRRKTLVHIQTHFPNPMRHYMTGLLFGYLDKEFDEQSQLYTSLGIIHL
FALSGMQVGFFLGWFRYGLLRLGLPKNYILAILLPFSIFYGLMTGWTASVLRSLIQSLLAECGIKKLNNMGITLLLFFLV
LPHFLLTVGGVLSCSYAFLLCLFNFEEMSSFKKSIYMSLVLSLGTLPFLTYYYGTFQPLSLILTAIFSLVFDSFLLPVLT
VLFTLSGMVIFSQFNTLFEWMEFFLTWVQSWGVQTLILGKPSLFQFVSMIFVLVLLFDFWKKPQFRISLLMIFSLLMVWV
KHPLINEVTVVDVGQGDSIFLRSMKGETVLIDVGGKVTFGSKKKWQEGSQTSNAEKTLIPYLQARGVSQIDYLVLTHTDT
DHIGDLEVVAKRFKIKKICVSEGALTKPSFAKRIRFIKCPVRTLKAGDKLPMMGSNLQVLYPNKIGDGGNNDSLVLYGKL
LGTSFLFTGDLEKEGEEELMASYPNLKVRVLKAGHHGSKGSSSEAFLDQLKPSLALVSAGENNRYKHPNDETLERFKERH
IKVLRTDQDGAIRFKGWFQLSSETVR

Nucleotide


Download         Length: 2241 bp        

>NTDB_id=357914 GQY29_RS05600 WP_159341007.1 1037193..1039433(+) (comEC/celB) [Streptococcus thermophilus strain EU01]
ATGTGGCTTAAAAAAGCTCCAATCAATCTTTTTTCCCTAGCGCTTTTAATAGTTGCTCTTTATTTTACTATTTTTGTATC
TAATTTCTATGCTATTGGGACTTTTGTCTTTCTGATGATATGTTTTTTGAGGCATCATTGGAAGAATAGAGCAGCTCTAA
AGTTGGTGGGACTTATAGGTGGTTTCTTTTTGGTCTACTTTTTATTTTTATACCATATAGCTATCATGCAAGATAAACAA
ACTCCTGCTGAAATTCATCAGGTGACACTGGTTGCAGATACGCTCTCAGTTAATGGTGAGCGATTATCAGCAATCGGTAA
GTCAAATGGACAAACCTATCAGGTCTTTTACCGGCTAAAATCTGATAGGGAGCAGCATTTTTTTAAGACTACTAGTCAAA
CGCTTGTTTTAAAAGGGAAAATAAAGTTGTCCTCGGCAACTGGTCAACGTAATTTTCAAGGATTTGATTATCAGTCTTAT
CTAGCTAGTCAGGGCATTTATAGGATTGCTCAGATTGAGCGCCTGGAACATGTCGTAACCCCAAAATCGATATCTCCAAT
AGCTTTTTTTCATCAATTGAGGAGGAAGACTCTAGTTCATATTCAGACGCATTTTCCTAATCCGATGAGACACTACATGA
CAGGACTGCTCTTTGGGTATTTGGACAAGGAGTTTGATGAGCAGAGTCAACTCTACACTAGCTTGGGGATTATTCATCTT
TTTGCGCTATCGGGTATGCAGGTTGGATTTTTTCTTGGCTGGTTTCGCTATGGACTTCTCCGTTTGGGGCTTCCCAAAAA
TTATATCCTTGCTATCTTATTACCTTTTTCGATTTTCTATGGCTTAATGACTGGTTGGACGGCTTCGGTCTTACGTTCTT
TGATTCAAAGCCTCTTGGCTGAGTGTGGTATTAAAAAACTGAACAATATGGGCATAACGCTACTTCTATTTTTTCTAGTC
TTGCCTCATTTTCTTTTAACGGTAGGAGGTGTTTTAAGTTGTTCTTATGCCTTCTTGTTGTGTTTATTTAATTTTGAGGA
GATGTCGTCCTTTAAAAAGTCAATTTATATGAGTTTAGTATTGAGTCTTGGGACTTTGCCTTTTTTGACCTACTATTATG
GAACTTTTCAACCATTGAGTTTGATTCTGACGGCAATCTTCTCTCTAGTTTTTGATAGCTTTCTCTTACCTGTCTTAACA
GTACTTTTTACACTTTCAGGAATGGTAATTTTTTCTCAATTTAACACACTTTTTGAATGGATGGAGTTCTTTTTGACTTG
GGTACAATCTTGGGGAGTCCAGACATTGATTTTAGGAAAACCTAGCTTGTTTCAGTTTGTCTCAATGATATTTGTATTGG
TTTTGCTCTTTGATTTTTGGAAAAAGCCTCAGTTTAGAATATCCCTCTTGATGATTTTTAGTCTTTTGATGGTCTGGGTC
AAACATCCTTTAATAAATGAAGTAACGGTGGTCGACGTTGGTCAAGGAGATAGTATTTTTTTAAGGAGTATGAAAGGTGA
AACGGTCCTAATAGATGTAGGTGGCAAGGTGACTTTCGGCTCTAAGAAAAAATGGCAAGAGGGGAGCCAGACGAGTAATG
CGGAGAAAACCTTAATTCCCTATCTACAGGCAAGGGGAGTGTCTCAAATTGACTATCTGGTTCTGACTCATACGGATACA
GACCATATTGGTGATTTGGAGGTAGTGGCTAAACGGTTTAAGATTAAGAAAATTTGTGTCAGTGAGGGGGCTTTGACTAA
GCCTAGTTTTGCCAAACGTATTCGATTTATTAAATGTCCCGTTCGCACTTTAAAGGCTGGTGATAAGCTGCCTATGATGG
GAAGTAACCTACAGGTTCTTTATCCCAATAAAATTGGTGATGGTGGTAACAATGATTCACTTGTTCTCTATGGAAAGTTA
TTGGGAACCAGTTTTCTGTTTACTGGTGATTTGGAAAAAGAAGGAGAAGAGGAATTGATGGCTAGCTATCCAAATTTAAA
AGTAAGGGTCCTCAAAGCAGGACATCACGGTTCTAAAGGCTCTTCATCAGAAGCTTTTTTGGACCAGCTAAAGCCATCAC
TTGCTCTTGTCTCAGCAGGTGAAAATAATCGTTATAAGCATCCAAATGATGAAACATTAGAGCGTTTCAAAGAACGTCAC
ATTAAGGTTTTACGCACAGACCAGGATGGTGCCATTCGGTTTAAGGGATGGTTCCAACTATCAAGTGAAACTGTCCGATA
A


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comEC/celB Streptococcus mitis NCTC 12261

47.587

100

0.476

  comEC/celB Streptococcus mitis SK321

46.452

100

0.465

  comEC/celB Streptococcus pneumoniae TIGR4

45.783

100

0.458

  comEC/celB Streptococcus pneumoniae D39

45.515

100

0.456

  comEC/celB Streptococcus pneumoniae Rx1

45.515

100

0.456

  comEC/celB Streptococcus pneumoniae R6

45.515

100

0.456

  comEC Lactococcus lactis subsp. cremoris KW2

44.828

97.185

0.436