Detailed information
Overview
| Name | comM | Type | Machinery gene |
| Locus tag | GR129_RS25200 | Genome accession | NZ_CP047144 |
| Coordinates | 5602384..5604009 (+) | Length | 541 a.a. |
| NCBI ID | WP_159705422.1 | Uniprot ID | - |
| Organism | Streptomyces sp. HF10 | ||
| Function | DNA uptake (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 5597384..5609009
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| GR129_RS25165 (GR129_25165) | lepB | 5597445..5598143 (+) | 699 | WP_145485577.1 | signal peptidase I | - |
| GR129_RS25170 (GR129_25170) | lepB | 5598136..5599227 (+) | 1092 | WP_159705413.1 | signal peptidase I | - |
| GR129_RS25175 (GR129_25175) | lepB | 5599115..5600125 (+) | 1011 | WP_145485575.1 | signal peptidase I | - |
| GR129_RS25180 (GR129_25180) | lepB | 5600237..5601022 (+) | 786 | WP_159705416.1 | signal peptidase I | - |
| GR129_RS25185 (GR129_25185) | - | 5601012..5601530 (+) | 519 | WP_159705419.1 | NUDIX hydrolase | - |
| GR129_RS25190 (GR129_25190) | - | 5601587..5601894 (+) | 308 | Protein_4976 | DUF2469 domain-containing protein | - |
| GR129_RS25195 (GR129_25195) | - | 5602021..5602383 (+) | 363 | WP_167532241.1 | YraN family protein | - |
| GR129_RS25200 (GR129_25200) | comM | 5602384..5604009 (+) | 1626 | WP_159705422.1 | YifB family Mg chelatase-like AAA ATPase | Machinery gene |
| GR129_RS25205 (GR129_25205) | dprA | 5604006..5605361 (+) | 1356 | WP_236576467.1 | DNA-processing protein DprA | - |
| GR129_RS25210 (GR129_25210) | whiG | 5605687..5606529 (+) | 843 | WP_145485569.1 | RNA polymerase sigma factor WhiG | - |
| GR129_RS25215 (GR129_25215) | - | 5606595..5607149 (+) | 555 | WP_159708595.1 | TetR/AcrR family transcriptional regulator | - |
| GR129_RS25220 (GR129_25220) | - | 5607162..5607758 (-) | 597 | WP_159705428.1 | M23 family metallopeptidase | - |
| GR129_RS25225 (GR129_25225) | rpsB | 5608030..5608938 (+) | 909 | WP_159705431.1 | 30S ribosomal protein S2 | - |
Sequence
Protein
Download Length: 541 a.a. Molecular weight: 56320.70 Da Isoelectric Point: 6.5641
>NTDB_id=357627 GR129_RS25200 WP_159705422.1 5602384..5604009(+) (comM) [Streptomyces sp. HF10]
MAFARTCSVALVGVEGVVVEVQADLEPGVAAFTLVGLPDKSLTESRDRVRAAVVNSGAPWPAKKLTVGLSPASVPKSGSG
FDLAVAAAVLGAAERIDPRVLADIVMIGELGLDGRVRPVRGILPAVLAAADAGYEQVVVPECAAAEAALVPGVSVLGVRS
LRQLIAVLAEEPVPEEEPDELGRPDPLLAGLRVPGTGAATGMHSLGAAQHDCEHDLADVVGQTSARTAVEVAAAGGHHLF
LEGPPGAGKTMLAERLPAVLPRLTREESLEVTAVHSVAGLLPPGKPLIDIAPYCAPHHSATMQSLVGGGPGIARPGAVSL
AHRGVLFLDEAPEFHSQTLDALRQPLESGHVVIARSAGVVRFPARFLMVLAANPCPCGRFSQRDALCECPPSAIRRYQAR
LSGPLLDRVDLRVEVDPVTRAQLTAPGARGEPTATVADRVRGARERTAARLAGSPWRTNSEVPGRELRSRFQAVSGAMDE
AERSLERGVLTARGIDRVLRVAWTVADLVGHDRPDATDVALALHLRTGVPRGVPMAIGALT
MAFARTCSVALVGVEGVVVEVQADLEPGVAAFTLVGLPDKSLTESRDRVRAAVVNSGAPWPAKKLTVGLSPASVPKSGSG
FDLAVAAAVLGAAERIDPRVLADIVMIGELGLDGRVRPVRGILPAVLAAADAGYEQVVVPECAAAEAALVPGVSVLGVRS
LRQLIAVLAEEPVPEEEPDELGRPDPLLAGLRVPGTGAATGMHSLGAAQHDCEHDLADVVGQTSARTAVEVAAAGGHHLF
LEGPPGAGKTMLAERLPAVLPRLTREESLEVTAVHSVAGLLPPGKPLIDIAPYCAPHHSATMQSLVGGGPGIARPGAVSL
AHRGVLFLDEAPEFHSQTLDALRQPLESGHVVIARSAGVVRFPARFLMVLAANPCPCGRFSQRDALCECPPSAIRRYQAR
LSGPLLDRVDLRVEVDPVTRAQLTAPGARGEPTATVADRVRGARERTAARLAGSPWRTNSEVPGRELRSRFQAVSGAMDE
AERSLERGVLTARGIDRVLRVAWTVADLVGHDRPDATDVALALHLRTGVPRGVPMAIGALT
Nucleotide
Download Length: 1626 bp
>NTDB_id=357627 GR129_RS25200 WP_159705422.1 5602384..5604009(+) (comM) [Streptomyces sp. HF10]
ATGGCATTCGCCCGCACCTGCTCCGTCGCCCTCGTCGGCGTCGAGGGCGTGGTCGTCGAGGTCCAGGCCGACCTCGAACC
CGGCGTCGCCGCCTTCACCCTGGTCGGCCTCCCGGACAAGAGCCTGACGGAGAGCAGGGACAGGGTGAGGGCGGCGGTGG
TGAATTCCGGCGCGCCGTGGCCCGCCAAGAAGCTCACCGTCGGCCTCAGCCCCGCGTCCGTGCCCAAGAGCGGAAGCGGC
TTCGACCTGGCGGTCGCCGCGGCCGTCCTCGGGGCCGCGGAACGGATCGACCCCCGGGTCCTCGCCGACATCGTGATGAT
CGGGGAACTCGGGCTGGACGGTCGGGTGCGTCCCGTACGGGGCATCCTGCCCGCGGTCCTCGCCGCGGCCGACGCGGGGT
ACGAGCAGGTGGTCGTGCCCGAGTGCGCCGCCGCGGAGGCCGCGCTGGTCCCCGGTGTCTCGGTGCTCGGCGTCCGCAGC
CTGCGCCAGCTCATCGCGGTACTGGCCGAGGAACCCGTGCCCGAGGAGGAGCCCGATGAACTGGGCCGCCCGGACCCGCT
GCTGGCCGGGCTTCGGGTGCCGGGCACCGGCGCCGCCACCGGCATGCACAGTCTCGGCGCGGCCCAGCACGACTGCGAGC
ACGACCTCGCGGACGTCGTCGGCCAGACCTCGGCCCGTACGGCCGTGGAGGTGGCCGCCGCCGGCGGACACCATCTGTTC
CTGGAGGGGCCGCCGGGCGCGGGCAAGACGATGCTGGCCGAACGCCTGCCCGCGGTGCTGCCGAGGCTCACCAGGGAGGA
GTCCCTGGAGGTCACAGCGGTGCACTCGGTGGCGGGGCTGCTGCCACCGGGCAAGCCGCTCATCGACATCGCCCCCTACT
GCGCCCCGCACCACTCGGCGACGATGCAGTCGCTCGTGGGCGGCGGCCCCGGCATCGCGCGCCCGGGGGCGGTGTCCCTC
GCCCATCGCGGAGTGCTGTTCCTGGACGAGGCACCCGAGTTCCACAGCCAGACCCTGGACGCGCTGCGGCAGCCCCTGGA
GTCCGGGCATGTCGTGATCGCGCGCAGCGCGGGAGTGGTCCGCTTTCCGGCGCGCTTCCTGATGGTGCTCGCGGCCAACC
CCTGCCCCTGCGGCCGCTTCTCCCAGCGCGACGCCCTGTGCGAGTGCCCGCCCTCGGCGATCCGCCGCTACCAGGCCCGG
CTCTCCGGGCCCCTGCTGGACCGGGTGGACCTGCGCGTCGAGGTCGATCCGGTCACCCGGGCCCAGCTCACCGCGCCGGG
CGCCCGCGGGGAGCCCACGGCGACCGTCGCGGACCGGGTCCGCGGGGCAAGGGAGCGTACGGCGGCCCGCCTCGCCGGCT
CACCCTGGCGCACCAACAGCGAGGTCCCCGGCAGGGAGCTGCGCAGCCGGTTCCAGGCCGTCAGCGGGGCGATGGACGAG
GCCGAGCGCAGCCTGGAGCGGGGCGTGCTCACCGCCCGTGGCATCGACCGGGTGCTGCGTGTCGCCTGGACGGTCGCCGA
CCTCGTCGGACACGACCGCCCGGACGCGACCGACGTCGCCCTCGCCCTGCATCTGCGCACCGGCGTCCCGCGCGGGGTCC
CGATGGCCATCGGCGCACTGACATGA
ATGGCATTCGCCCGCACCTGCTCCGTCGCCCTCGTCGGCGTCGAGGGCGTGGTCGTCGAGGTCCAGGCCGACCTCGAACC
CGGCGTCGCCGCCTTCACCCTGGTCGGCCTCCCGGACAAGAGCCTGACGGAGAGCAGGGACAGGGTGAGGGCGGCGGTGG
TGAATTCCGGCGCGCCGTGGCCCGCCAAGAAGCTCACCGTCGGCCTCAGCCCCGCGTCCGTGCCCAAGAGCGGAAGCGGC
TTCGACCTGGCGGTCGCCGCGGCCGTCCTCGGGGCCGCGGAACGGATCGACCCCCGGGTCCTCGCCGACATCGTGATGAT
CGGGGAACTCGGGCTGGACGGTCGGGTGCGTCCCGTACGGGGCATCCTGCCCGCGGTCCTCGCCGCGGCCGACGCGGGGT
ACGAGCAGGTGGTCGTGCCCGAGTGCGCCGCCGCGGAGGCCGCGCTGGTCCCCGGTGTCTCGGTGCTCGGCGTCCGCAGC
CTGCGCCAGCTCATCGCGGTACTGGCCGAGGAACCCGTGCCCGAGGAGGAGCCCGATGAACTGGGCCGCCCGGACCCGCT
GCTGGCCGGGCTTCGGGTGCCGGGCACCGGCGCCGCCACCGGCATGCACAGTCTCGGCGCGGCCCAGCACGACTGCGAGC
ACGACCTCGCGGACGTCGTCGGCCAGACCTCGGCCCGTACGGCCGTGGAGGTGGCCGCCGCCGGCGGACACCATCTGTTC
CTGGAGGGGCCGCCGGGCGCGGGCAAGACGATGCTGGCCGAACGCCTGCCCGCGGTGCTGCCGAGGCTCACCAGGGAGGA
GTCCCTGGAGGTCACAGCGGTGCACTCGGTGGCGGGGCTGCTGCCACCGGGCAAGCCGCTCATCGACATCGCCCCCTACT
GCGCCCCGCACCACTCGGCGACGATGCAGTCGCTCGTGGGCGGCGGCCCCGGCATCGCGCGCCCGGGGGCGGTGTCCCTC
GCCCATCGCGGAGTGCTGTTCCTGGACGAGGCACCCGAGTTCCACAGCCAGACCCTGGACGCGCTGCGGCAGCCCCTGGA
GTCCGGGCATGTCGTGATCGCGCGCAGCGCGGGAGTGGTCCGCTTTCCGGCGCGCTTCCTGATGGTGCTCGCGGCCAACC
CCTGCCCCTGCGGCCGCTTCTCCCAGCGCGACGCCCTGTGCGAGTGCCCGCCCTCGGCGATCCGCCGCTACCAGGCCCGG
CTCTCCGGGCCCCTGCTGGACCGGGTGGACCTGCGCGTCGAGGTCGATCCGGTCACCCGGGCCCAGCTCACCGCGCCGGG
CGCCCGCGGGGAGCCCACGGCGACCGTCGCGGACCGGGTCCGCGGGGCAAGGGAGCGTACGGCGGCCCGCCTCGCCGGCT
CACCCTGGCGCACCAACAGCGAGGTCCCCGGCAGGGAGCTGCGCAGCCGGTTCCAGGCCGTCAGCGGGGCGATGGACGAG
GCCGAGCGCAGCCTGGAGCGGGGCGTGCTCACCGCCCGTGGCATCGACCGGGTGCTGCGTGTCGCCTGGACGGTCGCCGA
CCTCGTCGGACACGACCGCCCGGACGCGACCGACGTCGCCCTCGCCCTGCATCTGCGCACCGGCGTCCCGCGCGGGGTCC
CGATGGCCATCGGCGCACTGACATGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comM | Vibrio campbellii strain DS40M4 |
39.962 |
98.521 |
0.394 |
| comM | Vibrio cholerae O1 biovar El Tor strain E7946 |
40.228 |
97.412 |
0.392 |
| comM | Vibrio cholerae strain A1552 |
40.228 |
97.412 |
0.392 |
| comM | Acinetobacter baylyi ADP1 |
39.412 |
94.27 |
0.372 |
| comM | Haemophilus influenzae Rd KW20 |
37.57 |
98.891 |
0.372 |
| comM | Legionella pneumophila str. Paris |
37.594 |
98.336 |
0.37 |
| comM | Legionella pneumophila strain ERS1305867 |
37.594 |
98.336 |
0.37 |
| comM | Glaesserella parasuis strain SC1401 |
36.981 |
97.967 |
0.362 |