Detailed information
Overview
| Name | comM | Type | Machinery gene |
| Locus tag | GSS20_RS15570 | Genome accession | NZ_CP047995 |
| Coordinates | 3322164..3323687 (-) | Length | 507 a.a. |
| NCBI ID | WP_140391724.1 | Uniprot ID | - |
| Organism | Vibrio parahaemolyticus strain 20150710009 | ||
| Function | DNA uptake (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 3317164..3328687
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| GSS20_RS15550 (GSS20_16365) | - | 3318445..3319431 (+) | 987 | WP_140391728.1 | serine/threonine protein kinase | - |
| GSS20_RS15555 (GSS20_16370) | - | 3319466..3320068 (+) | 603 | WP_005454748.1 | thiol:disulfide interchange protein DsbA/DsbL | - |
| GSS20_RS15560 (GSS20_16375) | - | 3320110..3320988 (-) | 879 | WP_020904428.1 | acyltransferase | - |
| GSS20_RS15565 (GSS20_16380) | - | 3321151..3322107 (+) | 957 | WP_140121309.1 | DUF2860 domain-containing protein | - |
| GSS20_RS15570 (GSS20_16385) | comM | 3322164..3323687 (-) | 1524 | WP_140391724.1 | YifB family Mg chelatase-like AAA ATPase | Machinery gene |
| GSS20_RS15575 (GSS20_16390) | ilvG | 3324152..3325798 (+) | 1647 | WP_005461385.1 | acetolactate synthase 2 catalytic subunit | - |
| GSS20_RS15580 (GSS20_16395) | ilvM | 3325809..3326093 (+) | 285 | WP_005378958.1 | acetolactate synthase 2 small subunit | - |
| GSS20_RS15585 (GSS20_16400) | ilvE | 3326106..3327044 (+) | 939 | WP_015297538.1 | branched-chain-amino-acid transaminase | - |
Sequence
Protein
Download Length: 507 a.a. Molecular weight: 55002.07 Da Isoelectric Point: 8.4861
>NTDB_id=366971 GSS20_RS15570 WP_140391724.1 3322164..3323687(-) (comM) [Vibrio parahaemolyticus strain 20150710009]
MGLAIIHSRASVGVQAPSVSVEVHISNGMPGFTLVGLPETTVKESKDRVRSAIINSNFQFPAKRITVNLAPADLPKEGGR
FDLPIALGILAASEQIATDRLKNYEFVGELALSGGLRPVKGVLPAALAASKVGRHLVVPHVNGDQAALVGKEQHKSAQSL
LEVCAELCGQHRLNIYQTPKRKTVEKHGRDLQDIIGQQQGKRALEIAAAGNHNLLFLGPPGTGKTMLASRLCDLLPEMSD
EEAMETASVASLTQSEINEHNWKSRPFRAPHHSSSMAALVGGGSVPRPGEISLAHNGLLFLDEMPEFDRKVLDSLREPLE
SGEIIISRAQGKTRFPARFQLVGALNPSPTGYYEGNQARTNPQAILRYLGRLSGPLLDRFDMSLEIPSLPKGTLAEGGDR
GEPTELVKERVSLARESMLNRNGKVNALLGSREIEAFCPLQKSDAEFLETALHRLGLSIRAYHRIIKVARTIADLEGAEQ
IERPHLAEALGYRAMDRLLKQLTAQAV
MGLAIIHSRASVGVQAPSVSVEVHISNGMPGFTLVGLPETTVKESKDRVRSAIINSNFQFPAKRITVNLAPADLPKEGGR
FDLPIALGILAASEQIATDRLKNYEFVGELALSGGLRPVKGVLPAALAASKVGRHLVVPHVNGDQAALVGKEQHKSAQSL
LEVCAELCGQHRLNIYQTPKRKTVEKHGRDLQDIIGQQQGKRALEIAAAGNHNLLFLGPPGTGKTMLASRLCDLLPEMSD
EEAMETASVASLTQSEINEHNWKSRPFRAPHHSSSMAALVGGGSVPRPGEISLAHNGLLFLDEMPEFDRKVLDSLREPLE
SGEIIISRAQGKTRFPARFQLVGALNPSPTGYYEGNQARTNPQAILRYLGRLSGPLLDRFDMSLEIPSLPKGTLAEGGDR
GEPTELVKERVSLARESMLNRNGKVNALLGSREIEAFCPLQKSDAEFLETALHRLGLSIRAYHRIIKVARTIADLEGAEQ
IERPHLAEALGYRAMDRLLKQLTAQAV
Nucleotide
Download Length: 1524 bp
>NTDB_id=366971 GSS20_RS15570 WP_140391724.1 3322164..3323687(-) (comM) [Vibrio parahaemolyticus strain 20150710009]
ATGGGGCTGGCAATCATTCATAGTCGGGCAAGTGTCGGGGTGCAAGCACCGTCAGTTAGTGTGGAAGTGCATATCAGTAA
TGGCATGCCCGGCTTTACTCTCGTTGGGTTGCCGGAGACTACGGTAAAGGAATCCAAAGATCGTGTACGCAGTGCGATCA
TCAATTCAAATTTCCAGTTTCCAGCCAAGCGCATTACGGTCAATTTGGCCCCGGCGGATTTACCTAAAGAAGGCGGACGT
TTTGATTTGCCTATCGCATTGGGTATTTTGGCGGCTTCAGAGCAAATCGCGACAGATAGGCTCAAAAACTACGAATTTGT
TGGCGAATTAGCCCTGTCTGGAGGATTAAGACCTGTTAAAGGTGTGCTTCCTGCCGCGTTGGCTGCAAGCAAAGTAGGAC
GTCATTTGGTGGTGCCTCATGTCAATGGCGATCAAGCAGCGTTGGTGGGCAAAGAGCAACATAAGTCAGCGCAATCCTTA
CTTGAGGTGTGTGCGGAGTTATGTGGTCAGCATCGTCTCAATATTTATCAAACTCCGAAGCGAAAAACGGTTGAAAAGCA
TGGTCGAGATCTACAAGACATCATTGGGCAGCAACAAGGCAAGCGTGCTCTAGAAATTGCGGCGGCTGGAAACCACAACC
TACTTTTTCTTGGTCCTCCTGGTACAGGAAAAACCATGCTGGCATCGCGTTTATGCGACTTACTGCCGGAGATGAGCGAC
GAAGAAGCGATGGAAACGGCTTCAGTCGCATCACTGACGCAAAGTGAGATTAATGAGCACAACTGGAAGTCGCGTCCGTT
TCGTGCGCCGCACCATTCCAGTTCGATGGCTGCATTAGTTGGTGGTGGCTCGGTGCCAAGACCGGGTGAGATTTCTTTGG
CTCACAATGGGTTATTGTTCCTTGATGAAATGCCGGAGTTTGACCGTAAAGTGTTGGACTCGTTACGAGAACCACTGGAA
TCGGGTGAGATCATCATTTCGCGCGCACAAGGAAAAACGCGTTTTCCTGCTCGTTTTCAGCTGGTGGGGGCGCTGAATCC
AAGCCCAACTGGCTATTACGAAGGGAATCAAGCTCGCACTAACCCTCAAGCTATTTTGCGTTACTTAGGTCGTTTATCGG
GACCGCTTCTCGACCGTTTTGATATGTCGTTAGAAATTCCATCCTTACCGAAAGGCACGTTGGCGGAAGGTGGTGACCGA
GGTGAACCCACAGAACTCGTCAAAGAGCGCGTCAGTCTTGCTCGCGAGAGCATGCTCAATCGAAACGGCAAAGTCAACGC
ACTGCTTGGCAGCCGTGAGATTGAGGCATTTTGTCCGTTGCAAAAAAGCGATGCGGAGTTTCTCGAAACTGCACTCCATC
GGCTGGGGTTATCGATTCGTGCCTATCATCGCATCATTAAAGTGGCCCGTACGATAGCGGATTTAGAAGGTGCTGAGCAG
ATTGAGCGGCCTCATTTGGCGGAAGCGCTCGGGTATCGCGCGATGGACCGATTGCTGAAACAACTCACGGCTCAAGCCGT
GTAG
ATGGGGCTGGCAATCATTCATAGTCGGGCAAGTGTCGGGGTGCAAGCACCGTCAGTTAGTGTGGAAGTGCATATCAGTAA
TGGCATGCCCGGCTTTACTCTCGTTGGGTTGCCGGAGACTACGGTAAAGGAATCCAAAGATCGTGTACGCAGTGCGATCA
TCAATTCAAATTTCCAGTTTCCAGCCAAGCGCATTACGGTCAATTTGGCCCCGGCGGATTTACCTAAAGAAGGCGGACGT
TTTGATTTGCCTATCGCATTGGGTATTTTGGCGGCTTCAGAGCAAATCGCGACAGATAGGCTCAAAAACTACGAATTTGT
TGGCGAATTAGCCCTGTCTGGAGGATTAAGACCTGTTAAAGGTGTGCTTCCTGCCGCGTTGGCTGCAAGCAAAGTAGGAC
GTCATTTGGTGGTGCCTCATGTCAATGGCGATCAAGCAGCGTTGGTGGGCAAAGAGCAACATAAGTCAGCGCAATCCTTA
CTTGAGGTGTGTGCGGAGTTATGTGGTCAGCATCGTCTCAATATTTATCAAACTCCGAAGCGAAAAACGGTTGAAAAGCA
TGGTCGAGATCTACAAGACATCATTGGGCAGCAACAAGGCAAGCGTGCTCTAGAAATTGCGGCGGCTGGAAACCACAACC
TACTTTTTCTTGGTCCTCCTGGTACAGGAAAAACCATGCTGGCATCGCGTTTATGCGACTTACTGCCGGAGATGAGCGAC
GAAGAAGCGATGGAAACGGCTTCAGTCGCATCACTGACGCAAAGTGAGATTAATGAGCACAACTGGAAGTCGCGTCCGTT
TCGTGCGCCGCACCATTCCAGTTCGATGGCTGCATTAGTTGGTGGTGGCTCGGTGCCAAGACCGGGTGAGATTTCTTTGG
CTCACAATGGGTTATTGTTCCTTGATGAAATGCCGGAGTTTGACCGTAAAGTGTTGGACTCGTTACGAGAACCACTGGAA
TCGGGTGAGATCATCATTTCGCGCGCACAAGGAAAAACGCGTTTTCCTGCTCGTTTTCAGCTGGTGGGGGCGCTGAATCC
AAGCCCAACTGGCTATTACGAAGGGAATCAAGCTCGCACTAACCCTCAAGCTATTTTGCGTTACTTAGGTCGTTTATCGG
GACCGCTTCTCGACCGTTTTGATATGTCGTTAGAAATTCCATCCTTACCGAAAGGCACGTTGGCGGAAGGTGGTGACCGA
GGTGAACCCACAGAACTCGTCAAAGAGCGCGTCAGTCTTGCTCGCGAGAGCATGCTCAATCGAAACGGCAAAGTCAACGC
ACTGCTTGGCAGCCGTGAGATTGAGGCATTTTGTCCGTTGCAAAAAAGCGATGCGGAGTTTCTCGAAACTGCACTCCATC
GGCTGGGGTTATCGATTCGTGCCTATCATCGCATCATTAAAGTGGCCCGTACGATAGCGGATTTAGAAGGTGCTGAGCAG
ATTGAGCGGCCTCATTTGGCGGAAGCGCTCGGGTATCGCGCGATGGACCGATTGCTGAAACAACTCACGGCTCAAGCCGT
GTAG
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comM | Vibrio campbellii strain DS40M4 |
94.083 |
100 |
0.941 |
| comM | Vibrio cholerae O1 biovar El Tor strain E7946 |
84.813 |
100 |
0.848 |
| comM | Vibrio cholerae strain A1552 |
84.813 |
100 |
0.848 |
| comM | Haemophilus influenzae Rd KW20 |
66.272 |
100 |
0.663 |
| comM | Glaesserella parasuis strain SC1401 |
64.706 |
100 |
0.651 |
| comM | Acinetobacter baylyi ADP1 |
49.499 |
98.422 |
0.487 |
| comM | Legionella pneumophila str. Paris |
49.798 |
97.83 |
0.487 |
| comM | Legionella pneumophila strain ERS1305867 |
49.798 |
97.83 |
0.487 |
| RA0C_RS07335 | Riemerella anatipestifer ATCC 11845 = DSM 15868 |
44.094 |
100 |
0.442 |