Detailed information    

insolico Bioinformatically predicted

Overview


Name   kpsS   Type   Regulator
Locus tag   JLZ95_RS04005 Genome accession   NZ_LR883012
Coordinates   841710..842930 (+) Length   406 a.a.
NCBI ID   WP_001735713.1    Uniprot ID   -
Organism   Escherichia coli isolate L4_E1441_ETEC     
Function   repress natural transformation (predicted from homology)   
Competence regulation

Genomic Context


Location: 836710..847930
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  JLZ95_RS03990 (ETECE1441_00815) rfbA 836854..837732 (+) 879 WP_000166786.1 glucose-1-phosphate thymidylyltransferase RfbA -
  JLZ95_RS03995 (ETECE1441_00816) rfbC 837798..838349 (+) 552 WP_001100778.1 dTDP-4-dehydrorhamnose 3,5-epimerase -
  JLZ95_RS04000 (ETECE1441_00817) - 838399..840546 (+) 2148 WP_000281770.1 capsular polysaccharide biosynthesis protein -
  JLZ95_RS04005 (ETECE1441_00818) kpsS 841710..842930 (+) 1221 WP_001735713.1 capsular biosynthesis protein Regulator
  JLZ95_RS04010 (ETECE1441_00819) - 842956..843186 (-) 231 Protein_800 hypothetical protein -
  JLZ95_RS04015 - 843292..843468 (-) 177 WP_000839288.1 DUF957 domain-containing protein -
  JLZ95_RS04020 (ETECE1441_00820) - 843485..843855 (-) 371 Protein_802 DUF5983 family protein -
  JLZ95_RS04025 (ETECE1441_00821) - 843918..844292 (-) 375 WP_000854765.1 TA system toxin CbtA family protein -
  JLZ95_RS04030 (ETECE1441_00822) - 844382..844750 (-) 369 WP_001295723.1 type IV toxin-antitoxin system YeeU family antitoxin -
  JLZ95_RS04035 (ETECE1441_00824) - 844913..845134 (-) 222 WP_001735710.1 DUF987 domain-containing protein -
  JLZ95_RS04040 (ETECE1441_00825) radC 845203..845679 (-) 477 WP_001186725.1 RadC family protein Machinery gene
  JLZ95_RS04045 (ETECE1441_00826) - 845695..846180 (-) 486 WP_001735709.1 antirestriction protein -
  JLZ95_RS04050 (ETECE1441_00827) - 846235..847053 (-) 819 WP_074481115.1 DUF932 domain-containing protein -
  JLZ95_RS04055 (ETECE1441_00828) - 847171..847366 (-) 196 Protein_809 DUF905 family protein -

Sequence


Protein


Download         Length: 406 a.a.        Molecular weight: 48421.92 Da        Isoelectric Point: 10.1710

>NTDB_id=1013345 JLZ95_RS04005 WP_001735713.1 841710..842930(+) (kpsS) [Escherichia coli isolate L4_E1441_ETEC]
MKNNALSILLSGKKYLLLQGPMGPFFNDIAEWLESLGRNAVNVVFNGGDRFYCRHRHYLAYYQTPKEFPGWLRDIHRQFD
FDTILCFGDCRPLHKEAKRWAKSKGIRFLAFEEGYLRPQFITVEEDGVNAYSSLPRDPDFYRKLPDMPAPHVENLKPSAM
KRIGHAMWYYLMGWHYRHEFTRYRHHKSFSPWYEARCWGRAYWRKLFYKIMQRNVLARLVNDLDQRYYLVILQVYNDSQI
RNHSNYNDVRDYINEVVYSFSHKAPKESYLVIKHHPMDRGHRLYRPLIKRLSKEYGLGERVIYVHDLPMPELLRHAKAVV
TINSTVGISALIHNKPLKVMGNALYDIKGLTYQGHLHQFWQADFKPDMKLFKKFREYLLMKTQINAVYYGVKSKSNRRSA
FLNGSR

Nucleotide


Download         Length: 1221 bp        

>NTDB_id=1013345 JLZ95_RS04005 WP_001735713.1 841710..842930(+) (kpsS) [Escherichia coli isolate L4_E1441_ETEC]
ATGAAAAATAATGCTCTGAGCATTTTATTATCTGGTAAAAAATATCTGCTATTGCAGGGGCCGATGGGACCTTTCTTCAA
TGATATTGCCGAGTGGTTAGAGTCATTAGGTCGTAACGCTGTGAATGTTGTATTCAATGGAGGGGATCGTTTTTACTGCC
GTCATCGACACTATCTGGCTTATTACCAAACGCCGAAAGAATTTCCTGGTTGGTTACGAGATATCCACCGGCAATTTGAC
TTTGATACCATTCTCTGTTTTGGTGACTGCCGTCCATTGCACAAAGAAGCAAAACGTTGGGCGAAGTCTAAAGGGATCCG
CTTTCTGGCATTTGAAGAAGGATATTTACGTCCGCAATTTATTACTGTTGAAGAGGACGGTGTAAACGCGTATTCATCGC
TGCCGCGCGATCCTGACTTTTATCGTAAATTACCAGATATGCCTGCACCACATGTTGAGAACTTAAAACCCTCGGCGATG
AAACGTATTGGTCATGCAATGTGGTATTACCTGATGGGATGGCATTACCGACATGAATTCACTCGCTACCGTCATCACAA
ATCATTTTCTCCTTGGTATGAGGCTCGTTGCTGGGGGCGTGCGTACTGGCGTAAGCTATTTTACAAAATAATGCAACGTA
ACGTATTGGCTCGGTTAGTGAATGATCTGGACCAACGTTACTATCTTGTTATTTTACAAGTTTATAATGATAGCCAAATT
CGTAATCACAGTAATTATAATGATGTGCGTGATTATATTAACGAAGTTGTATATTCATTTTCGCATAAGGCACCGAAAGA
GAGTTATTTGGTGATCAAACACCATCCGATGGATCGCGGTCACAGACTCTATCGACCATTAATTAAGCGGTTGAGTAAGG
AATATGGCTTAGGCGAGCGAGTCATATACGTACACGATCTCCCAATGCCGGAATTATTACGCCATGCAAAAGCGGTTGTG
ACAATTAACAGTACAGTGGGGATCTCTGCACTGATTCATAACAAACCACTCAAAGTGATGGGTAATGCTCTGTACGACAT
CAAGGGGTTGACGTATCAAGGGCATTTGCACCAATTCTGGCAGGCCGATTTTAAACCAGATATGAAACTGTTTAAGAAGT
TTCGTGAATATTTATTGATGAAGACGCAAATTAATGCTGTTTATTATGGTGTAAAATCAAAAAGCAATAGAAGGTCCGCA
TTCCTAAACGGTAGCAGATGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  kpsS Campylobacter jejuni subsp. jejuni NCTC 11168 = ATCC 700819

39.846

95.813

0.382


Multiple sequence alignment