Detailed information    

insolico Bioinformatically predicted

Overview


Name   kpsS   Type   Regulator
Locus tag   V6S34_RS20490 Genome accession   NZ_CP145671
Coordinates   4162693..4163913 (+) Length   406 a.a.
NCBI ID   WP_000794251.1    Uniprot ID   -
Organism   Escherichia coli strain S1-ZIM-01-A     
Function   repress natural transformation (predicted from homology)   
Competence regulation

Genomic Context


Location: 4157693..4168913
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  V6S34_RS20475 (V6S34_20475) rfbA 4157838..4158716 (+) 879 WP_000166786.1 glucose-1-phosphate thymidylyltransferase RfbA -
  V6S34_RS20480 (V6S34_20480) rfbC 4158782..4159333 (+) 552 WP_001100778.1 dTDP-4-dehydrorhamnose 3,5-epimerase -
  V6S34_RS20485 (V6S34_20485) - 4159383..4161530 (+) 2148 WP_000281770.1 capsular polysaccharide biosynthesis protein -
  V6S34_RS20490 (V6S34_20490) kpsS 4162693..4163913 (+) 1221 WP_000794251.1 capsular biosynthesis protein Regulator
  V6S34_RS20495 (V6S34_20495) - 4163939..4164169 (-) 231 Protein_4001 hypothetical protein -
  V6S34_RS20500 (V6S34_20500) - 4164275..4164451 (-) 177 WP_000839288.1 DUF957 domain-containing protein -
  V6S34_RS20505 (V6S34_20505) - 4164468..4164898 (-) 431 Protein_4003 DUF5983 family protein -
  V6S34_RS20510 (V6S34_20510) cbtA 4164895..4165272 (-) 378 WP_000854811.1 type IV toxin-antitoxin system cytoskeleton-binding toxin CbtA -
  V6S34_RS20515 (V6S34_20515) cbeA 4165361..4165729 (-) 369 WP_001285590.1 type IV toxin-antitoxin system cytoskeleton bundling-enhancing antitoxin CbeA -
  V6S34_RS20520 (V6S34_20520) yeeT 4165803..4166024 (-) 222 WP_000692300.1 DUF987 domain-containing protein -
  V6S34_RS20525 (V6S34_20525) radC 4166093..4166569 (-) 477 WP_001186725.1 RadC family protein Machinery gene
  V6S34_RS20530 (V6S34_20530) - 4166585..4167070 (-) 486 WP_000214310.1 antirestriction protein -
  V6S34_RS20535 (V6S34_20535) - 4167162..4167980 (-) 819 WP_001234593.1 DUF932 domain-containing protein -
  V6S34_RS20540 (V6S34_20540) - 4168098..4168269 (-) 172 Protein_4010 DUF905 family protein -
  V6S34_RS20545 (V6S34_20545) - 4168370..4168825 (-) 456 WP_000581502.1 IrmA family protein -

Sequence


Protein


Download         Length: 406 a.a.        Molecular weight: 48437.92 Da        Isoelectric Point: 10.1710

>NTDB_id=852045 V6S34_RS20490 WP_000794251.1 4162693..4163913(+) (kpsS) [Escherichia coli strain S1-ZIM-01-A]
MKNNALSILLSGKKYLLLQGPMGPFFNDVAEWLESLGRNAVNVVFNGGDRFYCRHRHYLAYYQTPKEFPGWLRDIHRQFD
FDTILCFGDCRPLHKEAKRWAKSKGIRFLAFEEGYLRPQFITVEEDGVNAYSSLPRDPDFYRKLPDMPAPHVENLKPSTM
KRIGHAMWYYLMGWHYRHEFTRYRHHKSFSPWYEARCWGRAYWRKLFYKIMQRNVLARLVNDLDQRYYLVILQVYNDSQI
RNHSNYNDVRDYINEVVYSFSHKAPKESYLVIKHHPMDRGHRLYRPLIKRLSKEYGLGERVIYVHDLPMPELLRHAKAVV
TINSTVGISALIHNKPLKVMGNALYDIKGLTYQGHLHQFWQADFKPDMKLFKKFREYLLMKTQINAVYYGVKSKSNRRSA
FLNGSR

Nucleotide


Download         Length: 1221 bp        

>NTDB_id=852045 V6S34_RS20490 WP_000794251.1 4162693..4163913(+) (kpsS) [Escherichia coli strain S1-ZIM-01-A]
ATGAAAAATAATGCTCTGAGCATTTTATTATCTGGTAAAAAATATCTGCTATTGCAGGGACCGATGGGACCTTTCTTCAA
TGATGTTGCCGAGTGGTTAGAGTCATTAGGTCGTAACGCTGTGAATGTTGTATTCAATGGAGGAGATCGTTTTTACTGCC
GTCATCGACACTATCTGGCTTATTACCAAACGCCGAAAGAATTTCCTGGTTGGTTACGAGATATCCACCGGCAATTTGAC
TTTGATACCATTCTCTGTTTTGGTGACTGCCGTCCATTGCACAAAGAAGCAAAACGTTGGGCGAAGTCTAAAGGGATCCG
CTTTCTGGCATTTGAAGAAGGATATTTACGTCCGCAATTTATTACTGTTGAAGAGGACGGTGTAAACGCGTATTCATCGC
TGCCGCGCGATCCTGACTTTTATCGTAAATTACCAGATATGCCTGCACCACATGTTGAGAACTTAAAACCCTCGACGATG
AAACGTATTGGTCATGCAATGTGGTATTACCTGATGGGATGGCATTACCGACATGAATTCACTCGCTACCGTCATCACAA
ATCATTTTCTCCTTGGTATGAGGCTCGTTGCTGGGGGCGTGCGTACTGGCGTAAGCTATTTTACAAAATAATGCAACGTA
ATGTATTGGCTCGGTTAGTGAATGATCTGGACCAACGTTACTATCTTGTTATTTTACAAGTTTATAATGATAGCCAAATT
CGTAATCACAGTAATTATAATGATGTGCGTGATTATATTAACGAAGTTGTATATTCATTTTCGCATAAGGCACCGAAAGA
GAGTTATTTGGTGATCAAACACCATCCGATGGATCGCGGTCACAGACTCTATCGACCATTAATTAAGCGGTTGAGTAAGG
AATATGGCTTAGGCGAGCGAGTCATATACGTACACGATCTCCCAATGCCGGAATTATTACGCCATGCAAAAGCGGTTGTG
ACAATTAACAGTACAGTGGGGATCTCTGCACTGATTCATAACAAACCACTCAAAGTGATGGGTAATGCTCTGTACGACAT
CAAGGGGTTGACGTATCAAGGGCATTTGCACCAATTCTGGCAGGCCGATTTTAAACCAGATATGAAACTGTTTAAGAAGT
TTCGTGAATATTTATTGATGAAGACGCAAATTAATGCTGTTTATTATGGTGTAAAATCAAAAAGCAATAGAAGGTCCGCA
TTCCTAAACGGTAGCAGATGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  kpsS Campylobacter jejuni subsp. jejuni NCTC 11168 = ATCC 700819

39.846

95.813

0.382