Detailed information    

insolico Bioinformatically predicted

Overview


Name   clpC   Type   Regulator
Locus tag   F22031_RS14020 Genome accession   NZ_CP007399
Coordinates   3061813..3064611 (+) Length   932 a.a.
NCBI ID   WP_003117917.1    Uniprot ID   -
Organism   Pseudomonas aeruginosa strain F22031     
Function   degradation of ComK; degradation of DegU (predicted from homology)   
Competence regulation

Genomic Context


Location: 3056813..3069611
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  F22031_RS13995 (F22031_14815) - 3058158..3058367 (+) 210 WP_003084710.1 cold-shock protein -
  F22031_RS14000 (F22031_14820) tnpA 3058499..3058930 (+) 432 WP_003460108.1 IS200/IS605 family transposase -
  F22031_RS14005 (F22031_14825) - 3059112..3059636 (+) 525 WP_003099931.1 ATP-dependent zinc protease -
  F22031_RS14010 (F22031_14830) - 3059630..3060004 (-) 375 WP_003099935.1 YkvA family protein -
  F22031_RS14015 (F22031_14835) mdtD 3060006..3061439 (-) 1434 WP_003084717.1 multidrug transporter subunit MdtD -
  F22031_RS14020 (F22031_14845) clpC 3061813..3064611 (+) 2799 WP_003117917.1 AAA family protein disaggregase ClpG Regulator
  F22031_RS14025 (F22031_14850) - 3064713..3065291 (+) 579 WP_003084725.1 DUF2780 domain-containing protein -
  F22031_RS14030 (F22031_14855) - 3065489..3066376 (-) 888 WP_003099939.1 acyltransferase -
  F22031_RS14035 (F22031_14860) - 3066519..3067028 (+) 510 WP_003084733.1 ATP-dependent zinc protease -
  F22031_RS14040 (F22031_14865) creB 3067113..3067802 (+) 690 WP_003084734.1 two-component system response regulator CreB -
  F22031_RS14045 (F22031_14870) creC 3067802..3069226 (+) 1425 WP_003099942.1 two-component system sensor histidine kinase CreC -

Sequence


Protein


Download         Length: 932 a.a.        Molecular weight: 103409.94 Da        Isoelectric Point: 6.8717

>NTDB_id=104244 F22031_RS14020 WP_003117917.1 3061813..3064611(+) (clpC) [Pseudomonas aeruginosa strain F22031]
MAQELCAICHERPAVARVSLVQNGQRRELALCELHYRQLMRQQRMRSPLESLFGGGSPFDEIFSGFGEQSPVTPVRAREP
EAVDIAEYFSKQTTEYLQRAAQVAAEFGKREVDTEHLLYALADADVVQAVLKQFGLSPADLKQYIEANAVRGASKGEASE
DMTISPRVKSALQHAFALSRELGHSYVGPEHLLLGLAAVPDSFAGTLLKKYGLTEQALRQKAVKVVGKGAEDGRVDGPSN
TPQLDKFSRDLTRLAREGKLDPVIGRSKEVETTIEVLARRKKNNPVLIGEPGVGKTAIVEGLAQRMVQGEVPEVLRDKRL
VELNINAMVAGAKYRGEFEERLKQVMDELQAAQSEIILFIDEVHTIVGAGQGGGEGGLDVANVLKPAMARGEMNLIGATT
LNEYQKYIEKDAALERRFQPVFVPEPTVEQTISILRGLRDKLEGHHKVTIRDEAFVAAAELSDRYIGNRFLPDKAIDLID
QAAARVRIASTSRPAEIQELEAELAQLKREQDYAASRKWYDEAKVFEKRIQERKEHLEQITERWQQTQGSKTEEVRVEDI
AEIISRLTGIPVTELTAEEREKLLQMEERLHQRVIGQQEAITAVSDAVRLARAGLRQGSRPIATFLFLGPTGVGKTELAK
ALAEVVFGDEDAMIRIDMSEYMERHAVSRLIGAPPGYVGYDEGGQLTERVRRRPYSVILLDEIEKAHADVNNILLQVFDD
GRLTDGKGRVVDFTNTIIIATSNLGSELIMKNAQAGEFAQPPEKLKRELMTTLRGHFRPEFLNRLDEVIVFESLSKAQIE
DIVRLQLERVKRAAHAQDIYLHIDDSLVGHLAEEAYQPEFGARELKRQIRQQLETRLATAMLKGEVKEGETVTFFYDAKD
GVGYRKGAAPKPAARKKSGAGETPKGRATAARKPAAKKGAAAKGKADKPKAK

Nucleotide


Download         Length: 2799 bp        

>NTDB_id=104244 F22031_RS14020 WP_003117917.1 3061813..3064611(+) (clpC) [Pseudomonas aeruginosa strain F22031]
ATGGCCCAGGAACTTTGCGCTATCTGCCACGAACGTCCCGCCGTCGCCCGCGTCAGCCTGGTACAGAACGGCCAGCGCCG
CGAACTCGCCCTCTGCGAACTGCACTACCGCCAGTTGATGCGCCAGCAGCGCATGCGCTCGCCGCTGGAGTCGCTGTTCG
GCGGCGGCAGCCCGTTCGACGAGATCTTCTCCGGCTTCGGCGAGCAGAGCCCGGTCACCCCGGTGCGCGCCCGCGAGCCG
GAGGCGGTGGACATCGCCGAGTACTTCAGCAAGCAGACCACCGAGTACCTGCAACGCGCCGCGCAGGTCGCCGCCGAATT
CGGCAAGCGCGAAGTGGACACCGAGCACCTGCTCTACGCCCTGGCCGACGCCGACGTGGTGCAGGCGGTGCTCAAGCAGT
TCGGCCTGTCGCCGGCCGACCTCAAGCAGTACATCGAGGCCAACGCCGTGCGCGGCGCCAGCAAGGGCGAGGCGAGCGAG
GACATGACCATCTCGCCGCGGGTGAAGAGCGCCTTGCAGCATGCCTTCGCCCTGTCCCGCGAACTCGGCCACAGCTATGT
CGGCCCCGAGCACCTGTTGCTCGGCCTGGCGGCGGTGCCGGACAGCTTCGCCGGGACGCTCCTGAAGAAGTACGGCCTGA
CCGAGCAGGCGCTACGGCAGAAAGCGGTCAAGGTGGTCGGCAAGGGCGCCGAGGACGGCCGCGTGGACGGCCCGAGCAAC
ACTCCGCAACTGGACAAGTTCAGCCGCGACCTGACCCGGCTGGCCCGCGAAGGCAAGCTCGATCCGGTGATCGGCCGCTC
GAAGGAAGTCGAGACCACCATCGAGGTTCTCGCCCGGCGCAAGAAGAACAACCCGGTGCTGATCGGCGAGCCCGGCGTCG
GCAAGACCGCCATCGTCGAAGGCCTGGCCCAGCGCATGGTCCAGGGCGAGGTGCCGGAGGTGCTGCGCGACAAGCGCCTG
GTCGAACTGAACATCAACGCCATGGTCGCCGGCGCCAAGTACCGCGGTGAGTTCGAGGAACGCCTCAAGCAGGTGATGGA
CGAACTGCAGGCGGCGCAGAGCGAGATCATCCTGTTCATCGACGAGGTGCACACCATCGTCGGTGCCGGCCAGGGCGGCG
GCGAAGGCGGGCTGGACGTGGCCAACGTGCTGAAGCCGGCGATGGCGCGCGGCGAGATGAACCTGATCGGCGCCACCACC
CTCAACGAGTACCAGAAGTACATCGAGAAGGACGCCGCGCTGGAGCGGCGCTTCCAGCCGGTGTTCGTCCCCGAGCCGAC
GGTGGAGCAGACCATCTCCATCCTCCGTGGCCTGCGCGACAAGCTCGAAGGCCACCACAAGGTGACCATCCGCGACGAGG
CCTTCGTCGCCGCCGCCGAGCTGTCCGATCGCTACATCGGCAACCGCTTCCTGCCGGACAAGGCCATCGACCTGATCGAC
CAGGCCGCCGCCCGCGTGCGCATCGCCAGCACCTCGCGGCCGGCCGAGATCCAGGAACTGGAGGCCGAGCTGGCGCAGCT
CAAGCGCGAGCAGGACTACGCCGCCAGCCGCAAGTGGTACGACGAGGCGAAGGTCTTCGAGAAACGCATCCAGGAACGCA
AGGAACACCTCGAGCAGATCACCGAGCGCTGGCAGCAGACCCAGGGGTCGAAGACCGAGGAGGTGCGGGTCGAGGACATC
GCCGAGATCATCTCCAGGCTCACCGGCATCCCGGTCACCGAACTGACCGCCGAGGAGCGCGAGAAGCTCCTGCAGATGGA
AGAGCGCCTGCACCAGCGGGTGATCGGCCAGCAGGAAGCGATCACCGCGGTCAGCGACGCCGTGCGCCTGGCCCGCGCCG
GGCTGCGCCAGGGCAGCCGGCCGATCGCCACCTTCCTGTTCCTCGGCCCGACCGGGGTGGGCAAGACCGAGCTGGCCAAG
GCCCTGGCCGAGGTGGTGTTCGGCGACGAAGACGCGATGATCCGCATCGACATGAGCGAATACATGGAGCGCCACGCGGT
GTCCCGGCTGATCGGTGCGCCGCCGGGCTACGTCGGCTACGACGAGGGCGGCCAGCTCACCGAGCGGGTGCGCCGGCGGC
CTTACAGCGTGATCCTGCTCGACGAGATCGAGAAGGCCCACGCCGACGTCAACAACATCCTCCTGCAGGTGTTCGACGAC
GGCCGCCTGACCGACGGCAAGGGGCGCGTGGTGGACTTCACCAATACCATCATCATCGCCACCAGCAACCTAGGCTCCGA
GCTGATCATGAAGAACGCCCAGGCCGGCGAGTTCGCCCAGCCGCCGGAGAAGCTCAAGCGCGAACTGATGACTACCCTGC
GCGGACATTTCCGCCCGGAATTCCTCAACCGCCTCGACGAGGTGATCGTCTTCGAGTCGCTGAGCAAGGCGCAGATCGAG
GACATCGTGCGCCTGCAACTGGAGCGGGTGAAGCGCGCCGCGCACGCTCAGGACATCTACCTGCACATCGACGACAGCCT
GGTCGGCCACCTCGCCGAAGAGGCCTACCAGCCGGAGTTCGGCGCCCGCGAGCTGAAGCGGCAGATCCGCCAGCAACTGG
AGACGCGCCTGGCCACGGCGATGCTCAAGGGCGAGGTGAAAGAGGGCGAGACGGTCACCTTCTTCTACGACGCCAAGGAC
GGCGTCGGCTACCGCAAGGGCGCCGCGCCGAAGCCGGCGGCACGCAAGAAATCCGGCGCCGGCGAGACGCCCAAGGGCCG
CGCGACGGCGGCGAGGAAGCCGGCGGCGAAGAAAGGCGCCGCCGCCAAGGGCAAGGCCGACAAGCCGAAGGCCAAGTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  clpC Bacillus subtilis subsp. subtilis str. 168

50.374

86.052

0.433

  clpC Lactococcus lactis subsp. lactis strain DGCC12653

45.113

85.622

0.386

  clpC Streptococcus thermophilus LMD-9

42.805

88.734

0.38

  clpC Streptococcus thermophilus LMG 18311

42.563

88.734

0.378

  clpC Streptococcus mutans UA159

41.383

88.412

0.366