Detailed information    

insolico Bioinformatically predicted

Overview


Name   comF   Type   Machinery gene
Locus tag   MKF35_RS04475 Genome accession   NZ_CP092629
Coordinates   945421..946146 (+) Length   241 a.a.
NCBI ID   WP_003103309.1    Uniprot ID   Q9I629
Organism   Pseudomonas aeruginosa strain HU20     
Function   ssDNA transport into the cell (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 940421..951146
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  MKF35_RS04445 - 940541..941419 (-) 879 WP_003103323.1 allophanate hydrolase subunit 1 -
  MKF35_RS04450 - 941421..942797 (-) 1377 WP_003103320.1 acetyl-CoA carboxylase biotin carboxylase subunit -
  MKF35_RS04455 - 942808..943056 (-) 249 WP_003084813.1 acetyl-CoA carboxylase -
  MKF35_RS04460 - 943133..943891 (-) 759 WP_003103315.1 5-oxoprolinase subunit PxpA -
  MKF35_RS04465 - 944009..944935 (+) 927 WP_003118849.1 LysR family transcriptional regulator -
  MKF35_RS04470 - 944989..945282 (+) 294 WP_003084806.1 hypothetical protein -
  MKF35_RS04475 comF 945421..946146 (+) 726 WP_003103309.1 ComF family protein Machinery gene
  MKF35_RS04480 - 946188..946508 (+) 321 WP_016263902.1 YfiM family lipoprotein -
  MKF35_RS04485 - 946576..947334 (+) 759 WP_016852387.1 TOBE domain-containing protein -
  MKF35_RS04490 - 947396..948370 (+) 975 WP_003084794.1 serine/threonine protein kinase -
  MKF35_RS04495 rarD 948573..949469 (+) 897 WP_003103301.1 EamA family transporter RarD -
  MKF35_RS04500 - 950159..950674 (-) 516 WP_047105372.1 glycine cleavage system protein R -

Sequence


Protein


Download         Length: 241 a.a.        Molecular weight: 27088.60 Da        Isoelectric Point: 11.2212

>NTDB_id=567190 MKF35_RS04475 WP_003103309.1 945421..946146(+) (comF) [Pseudomonas aeruginosa strain HU20]
MSFPLRPLTRWLLPPPACLLCAARSDQPPRPLCRACAADLPWSRQQCRRCALPLPLDGQVCGECLRRPPAYEQAIAPWRY
AFPLDSLINRFKHQAAWPLGRLLGELLAEHLRQRYAEGLPRPARLLPVPLAPRRERRRGFNQAQQLAERLAGELDLRCDP
HSLRRVLDTPAQQGLDATVRRRNLRHAFALAPASDVRGLHLALVDDVLTTGATAERLSRLLRRAGAARVDVYCLARTPKP
G

Nucleotide


Download         Length: 726 bp        

>NTDB_id=567190 MKF35_RS04475 WP_003103309.1 945421..946146(+) (comF) [Pseudomonas aeruginosa strain HU20]
ATGTCGTTCCCGCTTCGTCCTCTCACGCGCTGGCTTTTGCCGCCGCCGGCCTGCCTGCTCTGCGCCGCCCGCAGCGACCA
GCCGCCCCGCCCGCTGTGCCGCGCCTGTGCCGCCGACCTGCCCTGGTCGCGCCAGCAGTGCCGGCGCTGCGCCCTGCCCC
TGCCGCTGGACGGCCAGGTGTGCGGCGAGTGCCTGCGCCGCCCGCCGGCCTATGAACAGGCGATCGCGCCCTGGCGCTAC
GCCTTTCCGCTCGACAGCCTGATCAACCGCTTCAAGCACCAGGCGGCCTGGCCGCTGGGGCGGCTGCTCGGCGAGTTGCT
GGCGGAACACCTGCGGCAACGCTACGCCGAAGGCCTGCCGCGCCCGGCACGCCTGCTGCCGGTCCCGCTGGCGCCTCGGC
GCGAACGTCGTCGCGGCTTCAACCAGGCGCAACAGCTCGCCGAGCGACTGGCTGGCGAGCTGGACCTGCGCTGCGATCCG
CACAGCCTGCGGCGAGTGCTGGATACTCCGGCCCAGCAGGGGCTGGACGCGACGGTGCGGCGGCGCAACCTGCGCCACGC
CTTCGCCCTGGCGCCCGCCAGCGATGTTCGCGGGCTGCACCTGGCACTGGTGGACGACGTGCTCACCACCGGGGCCACCG
CCGAGCGCCTTTCCCGCCTGTTGCGCCGGGCGGGCGCCGCGCGGGTCGACGTCTACTGCCTGGCGCGCACGCCGAAGCCC
GGCTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB Q9I629

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comF Vibrio cholerae strain A1552

38.174

100

0.382