Detailed information    

insolico Bioinformatically predicted

Overview


Name   comF   Type   Machinery gene
Locus tag   QZL40_RS01475 Genome accession   NZ_CP129936
Coordinates   301628..302353 (-) Length   241 a.a.
NCBI ID   WP_140383682.1    Uniprot ID   -
Organism   Vibrio parahaemolyticus strain I13A     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 296628..307353
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  QZL40_RS01450 - 297745..298236 (+) 492 WP_005458943.1 type II secretion system protein M -
  QZL40_RS01455 - 298238..299002 (+) 765 WP_308390465.1 type II secretion system protein N -
  QZL40_RS01460 cysQ 299288..300115 (-) 828 WP_005458987.1 3'(2'),5'-bisphosphate nucleotidase CysQ -
  QZL40_RS01465 nudE 300156..300725 (-) 570 WP_021448936.1 ADP compounds hydrolase NudE -
  QZL40_RS01470 nfuA 300946..301530 (-) 585 WP_005458964.1 Fe-S biogenesis protein NfuA -
  QZL40_RS01475 comF 301628..302353 (-) 726 WP_140383682.1 ComF family protein Machinery gene
  QZL40_RS01480 bioH 302438..303205 (+) 768 WP_031820331.1 pimeloyl-ACP methyl ester esterase BioH -
  QZL40_RS01485 - 303329..303793 (+) 465 WP_005459035.1 hypothetical protein -
  QZL40_RS01490 - 303929..306250 (-) 2322 WP_308390464.1 Tex family protein -

Sequence


Protein


Download         Length: 241 a.a.        Molecular weight: 27703.94 Da        Isoelectric Point: 8.9991

>NTDB_id=781435 QZL40_RS01475 WP_140383682.1 301628..302353(-) (comF) [Vibrio parahaemolyticus strain I13A]
MLSHHWQNIMHRVLSSQCGLCRFPILAAAQPNALRWCDHCYQYLTPVKRCQRCGLSLKAEEANIESICGECLSEPPPWQR
LFTLGDYDFPLSREVQRFKDHGQIWHVRALTQLLAQRISTPAPLITTVPLHWQRYLYRGFNQSDILARHLAGHLNVRFDN
HVFRRVKHVQSQRGYKKSSREQNLKGAFTLNQPPKYNHVAIVDDVVTTGSTVRQLCHLLLEVGVETVDIYCICRTPAPGA
V

Nucleotide


Download         Length: 726 bp        

>NTDB_id=781435 QZL40_RS01475 WP_140383682.1 301628..302353(-) (comF) [Vibrio parahaemolyticus strain I13A]
ATGTTATCTCATCACTGGCAAAACATCATGCATCGTGTGCTCAGCAGTCAATGCGGTTTATGTCGCTTCCCGATTCTGGC
TGCCGCTCAACCCAATGCGCTGCGTTGGTGTGATCACTGTTATCAATATCTTACGCCAGTAAAACGCTGCCAACGCTGTG
GATTGAGCTTAAAAGCTGAGGAAGCGAATATAGAGAGTATTTGCGGCGAGTGCCTCTCCGAGCCTCCCCCTTGGCAACGG
CTATTTACCTTGGGAGACTACGATTTTCCGCTGTCTCGAGAAGTACAACGCTTCAAAGATCACGGACAAATATGGCATGT
TCGCGCTTTAACGCAATTGCTTGCCCAGCGCATTTCAACTCCCGCTCCGCTTATCACCACAGTGCCATTGCACTGGCAAC
GCTACTTGTATCGAGGCTTTAATCAGAGCGACATACTGGCGCGACATTTGGCTGGTCACCTTAATGTGAGGTTTGATAAT
CACGTGTTTCGCCGCGTAAAACACGTCCAGTCGCAGCGTGGGTACAAGAAATCCAGCCGAGAACAGAATTTAAAAGGCGC
TTTCACCTTAAATCAGCCACCAAAGTATAACCACGTCGCAATCGTAGATGATGTGGTCACGACGGGAAGCACGGTTCGAC
AATTATGTCATTTACTACTTGAAGTTGGCGTAGAAACCGTCGATATTTACTGCATCTGCAGAACCCCTGCTCCTGGTGCT
GTCTAG


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comF Vibrio campbellii strain DS40M4

72.614

100

0.726

  comF Vibrio cholerae strain A1552

49.16

98.755

0.485