Detailed information    

insolico Bioinformatically predicted

Overview


Name   comGA/cglA/cilD   Type   Machinery gene
Locus tag   I6G43_RS01760 Genome accession   NZ_CP065706
Coordinates   363077..364018 (+) Length   313 a.a.
NCBI ID   WP_038805745.1    Uniprot ID   -
Organism   Streptococcus oralis strain FDAARGOS_886     
Function   dsDNA binding to the cell surface; assembly of the pseudopilus (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 358077..369018
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  I6G43_RS01740 (I6G43_01740) - 358581..360398 (+) 1818 WP_038805748.1 acyltransferase family protein -
  I6G43_RS01745 (I6G43_01745) nagA 360539..361690 (+) 1152 WP_001134442.1 N-acetylglucosamine-6-phosphate deacetylase -
  I6G43_RS01750 (I6G43_01750) tnpA 361832..362347 (-) 516 Protein_329 IS200/IS605 family transposase -
  I6G43_RS01755 (I6G43_01755) - 362646..363011 (+) 366 WP_038805747.1 DUF1033 family protein -
  I6G43_RS01760 (I6G43_01760) comGA/cglA/cilD 363077..364018 (+) 942 WP_038805745.1 competence type IV pilus ATPase ComGA Machinery gene
  I6G43_RS01765 (I6G43_01765) comGB/cglB 363966..364982 (+) 1017 WP_068981970.1 competence type IV pilus assembly protein ComGB Machinery gene
  I6G43_RS01770 (I6G43_01770) comGC/cglC 364984..365307 (+) 324 WP_038805744.1 competence type IV pilus major pilin ComGC Machinery gene
  I6G43_RS01775 (I6G43_01775) comGD/cglD 365270..365704 (+) 435 WP_038805743.1 competence type IV pilus minor pilin ComGD Machinery gene
  I6G43_RS01780 (I6G43_01780) comGE/cglE 365667..365969 (+) 303 WP_000413373.1 competence type IV pilus minor pilin ComGE Machinery gene
  I6G43_RS01785 (I6G43_01785) comGF/cglF 365932..366393 (+) 462 WP_000531552.1 competence type IV pilus minor pilin ComGF Machinery gene
  I6G43_RS01790 (I6G43_01790) comGG/cglG 366371..366796 (+) 426 WP_000265654.1 competence type IV pilus minor pilin ComGG Machinery gene
  I6G43_RS01795 (I6G43_01795) - 366806..367396 (+) 591 WP_000679771.1 class I SAM-dependent methyltransferase -
  I6G43_RS01800 (I6G43_01800) comGH 367455..368408 (+) 954 WP_001008566.1 class I SAM-dependent methyltransferase Machinery gene

Sequence


Protein


Download         Length: 313 a.a.        Molecular weight: 35443.46 Da        Isoelectric Point: 5.8179

>NTDB_id=450683 I6G43_RS01760 WP_038805745.1 363077..364018(+) (comGA/cglA/cilD) [Streptococcus oralis strain FDAARGOS_886]
MVQEIAQKIIATAKEKGAQDIYFIPKEVTYELHMRIGDERCLVDSYEFEVLAAVISHFKFVAGMNVGEKRRSQLGSCDYQ
HGEKLSSLRLSTVGDYRGHESLVIRLLHDEERELRFWFQDLAKLGEQYRQRGLYLFAGPVGSGKTTLMHELAKSLFKGQQ
VMSIEDPVEIKQEDMLQLQLNEAIGLTYENLIKLSLRHRPDLLIIGEIRDSETARAVVRASLTGATVFSTIHAKSIRGVY
ERLLELGVTEEELAVVLQGVCYQRLIGGGGILDFANKNYQDHQPTSWNEQIDQLLKDGHITSLQAETEKIGYS

Nucleotide


Download         Length: 942 bp        

>NTDB_id=450683 I6G43_RS01760 WP_038805745.1 363077..364018(+) (comGA/cglA/cilD) [Streptococcus oralis strain FDAARGOS_886]
ATGGTACAAGAAATTGCACAGAAAATTATTGCTACTGCTAAGGAAAAAGGAGCTCAGGATATCTATTTCATTCCCAAAGA
AGTTACTTATGAACTTCATATGCGAATTGGCGATGAGAGGTGTTTAGTTGACTCCTATGAATTTGAGGTTTTAGCAGCTG
TAATTAGTCACTTCAAGTTTGTGGCGGGTATGAATGTAGGAGAAAAACGCCGTAGTCAGCTGGGCTCTTGTGACTACCAG
CATGGGGAAAAGCTATCTTCTCTGCGTTTATCTACCGTAGGAGATTATCGGGGACATGAGAGCTTGGTCATTCGGTTGTT
GCACGATGAGGAAAGGGAGTTGCGATTTTGGTTTCAGGATTTAGCAAAATTGGGAGAACAATACAGGCAAAGGGGGCTCT
ACCTTTTTGCGGGTCCAGTCGGCAGTGGTAAGACGACCTTGATGCACGAATTAGCCAAGTCTCTTTTTAAGGGGCAGCAG
GTTATGTCCATCGAAGATCCTGTCGAAATCAAGCAGGAAGACATGCTCCAGTTGCAGTTGAATGAGGCAATTGGATTGAC
CTATGAAAATCTGATCAAACTGTCTCTCCGACATCGTCCTGACCTCTTGATAATCGGTGAAATTCGGGACAGTGAGACGG
CGCGTGCAGTTGTCAGAGCCAGTTTGACAGGTGCGACGGTCTTTTCAACCATTCATGCCAAGAGTATCCGAGGTGTTTAT
GAGCGCCTTCTGGAGTTAGGTGTGACTGAGGAGGAACTAGCAGTTGTCTTACAAGGCGTCTGTTATCAGAGATTAATCGG
GGGAGGAGGAATCCTTGACTTTGCAAACAAAAACTATCAAGACCACCAGCCAACTAGCTGGAATGAGCAGATTGACCAGC
TTCTTAAAGATGGACATATCACAAGTCTTCAGGCTGAAACGGAAAAAATTGGCTACAGCTAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comGA/cglA/cilD Streptococcus mitis NCTC 12261

87.54

100

0.875

  comGA/cglA/cilD Streptococcus pneumoniae Rx1

86.581

100

0.866

  comGA/cglA/cilD Streptococcus pneumoniae D39

86.581

100

0.866

  comGA/cglA/cilD Streptococcus pneumoniae R6

86.581

100

0.866

  comGA/cglA/cilD Streptococcus pneumoniae TIGR4

86.581

100

0.866

  comGA Streptococcus gordonii str. Challis substr. CH1

78.387

99.042

0.776

  comGA Streptococcus mutans UA159

64.952

99.361

0.645

  comGA Streptococcus mutans UA140

64.952

99.361

0.645

  comGA/cglA Streptococcus sobrinus strain NIDR 6715-7

61.613

99.042

0.61

  comGA Lactococcus lactis subsp. cremoris KW2

55.949

99.361

0.556

  comGA Latilactobacillus sakei subsp. sakei 23K

44.106

84.026

0.371