Detailed information
Overview
| Name | comM | Type | Machinery gene |
| Locus tag | C8250_RS30370 | Genome accession | NZ_CP048835 |
| Coordinates | 6767491..6769101 (+) | Length | 536 a.a. |
| NCBI ID | WP_138356435.1 | Uniprot ID | - |
| Organism | Streptomyces sp. So13.3 | ||
| Function | DNA uptake (predicted from homology) DNA binding and uptake |
||
Genomic Context
Location: 6762491..6774101
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| C8250_RS30335 (C8250_030350) | lepB | 6762593..6763303 (+) | 711 | WP_138356440.1 | signal peptidase I | - |
| C8250_RS30340 (C8250_030355) | lepB | 6763365..6764576 (+) | 1212 | WP_138356439.1 | signal peptidase I | - |
| C8250_RS30345 (C8250_030360) | lepB | 6764665..6765372 (+) | 708 | WP_232486039.1 | signal peptidase I | - |
| C8250_RS30350 (C8250_030365) | lepB | 6765438..6766169 (+) | 732 | WP_138356438.1 | signal peptidase I | - |
| C8250_RS30355 (C8250_030370) | - | 6766169..6766648 (+) | 480 | WP_138356497.1 | NUDIX domain-containing protein | - |
| C8250_RS30360 (C8250_030375) | - | 6766688..6767014 (+) | 327 | WP_138356437.1 | DUF2469 domain-containing protein | - |
| C8250_RS30365 (C8250_030380) | - | 6767132..6767491 (+) | 360 | WP_138356436.1 | YraN family protein | - |
| C8250_RS30370 (C8250_030385) | comM | 6767491..6769101 (+) | 1611 | WP_138356435.1 | YifB family Mg chelatase-like AAA ATPase | Machinery gene |
| C8250_RS30375 (C8250_030390) | dprA | 6769101..6770246 (+) | 1146 | WP_138356434.1 | DNA-processing protein DprA | - |
| C8250_RS30380 (C8250_030395) | whiG | 6770514..6771350 (+) | 837 | WP_138356433.1 | RNA polymerase sigma factor WhiG | - |
| C8250_RS43775 (C8250_030400) | - | 6771401..6771952 (+) | 552 | Protein_6072 | helix-turn-helix domain-containing protein | - |
| C8250_RS30390 (C8250_030405) | - | 6772095..6772748 (-) | 654 | Protein_6073 | M23 family metallopeptidase | - |
| C8250_RS30395 (C8250_030410) | rpsB | 6773022..6773966 (+) | 945 | WP_138356738.1 | 30S ribosomal protein S2 | - |
Sequence
Protein
Download Length: 536 a.a. Molecular weight: 56121.56 Da Isoelectric Point: 7.4426
>NTDB_id=370932 C8250_RS30370 WP_138356435.1 6767491..6769101(+) (comM) [Streptomyces sp. So13.3]
MGFARTCSVALVGVEGVVVEVQADLEPGLAAFTLVGLPDKSLSESRDRVRAAIVNSGETWPQKKLTVGLSPASVPKSGSG
FDLGVACAVLAANERLAPRAIADLMMIGELGLDGRVRPVRGVLPAVLAAADAGYRHVVVPERTAAEASLVPGVSVLGIRT
LRQLVAILNDETVPEEEEDRDEGRPDPLFAGLAVPGAGMGTGVSGREVVPDLADVAGQHTARRALEISAAGGHHLYLKGP
PGAGKTMLAERLAGLLPRLTAQESLEVTAVHSVAGILPPGKPLIDTPPYCAPHHSATMPSIIGGGSGLPRPGAVSLAHRG
VLFLDEAPEFSGRVLDAMRQPLESGHVVVARSAGVMRLPARFLLALAANPCPCGRYSLLGLGCDCSPAAVRRYQARLSGP
LLDRVDLRVQVEAVTRTELIEGASGAEPSARVADRVRLARERAAVRYAETPWRTNSEVPGHELRTRWQVGPAGLREAERD
MERGLLTARGLDRVLRVAWTIADLAGVERPGPREMAEALQLRTGVARGVPAVVGGG
MGFARTCSVALVGVEGVVVEVQADLEPGLAAFTLVGLPDKSLSESRDRVRAAIVNSGETWPQKKLTVGLSPASVPKSGSG
FDLGVACAVLAANERLAPRAIADLMMIGELGLDGRVRPVRGVLPAVLAAADAGYRHVVVPERTAAEASLVPGVSVLGIRT
LRQLVAILNDETVPEEEEDRDEGRPDPLFAGLAVPGAGMGTGVSGREVVPDLADVAGQHTARRALEISAAGGHHLYLKGP
PGAGKTMLAERLAGLLPRLTAQESLEVTAVHSVAGILPPGKPLIDTPPYCAPHHSATMPSIIGGGSGLPRPGAVSLAHRG
VLFLDEAPEFSGRVLDAMRQPLESGHVVVARSAGVMRLPARFLLALAANPCPCGRYSLLGLGCDCSPAAVRRYQARLSGP
LLDRVDLRVQVEAVTRTELIEGASGAEPSARVADRVRLARERAAVRYAETPWRTNSEVPGHELRTRWQVGPAGLREAERD
MERGLLTARGLDRVLRVAWTIADLAGVERPGPREMAEALQLRTGVARGVPAVVGGG
Nucleotide
Download Length: 1611 bp
>NTDB_id=370932 C8250_RS30370 WP_138356435.1 6767491..6769101(+) (comM) [Streptomyces sp. So13.3]
ATGGGCTTCGCCCGCACCTGCTCGGTGGCCCTGGTCGGCGTGGAGGGCGTGGTCGTCGAGGTCCAGGCCGACCTCGAACC
GGGGCTGGCCGCGTTCACCCTCGTCGGACTGCCCGACAAGAGCCTGAGCGAGAGCCGCGACCGCGTCCGGGCGGCGATCG
TGAACAGCGGAGAGACCTGGCCGCAGAAGAAACTCACCGTGGGCCTCAGCCCCGCCTCGGTCCCCAAGAGCGGCAGCGGC
TTCGATCTCGGGGTCGCGTGCGCGGTCCTCGCCGCCAACGAACGGCTCGCGCCCCGGGCCATCGCCGATCTGATGATGAT
CGGCGAGCTGGGCCTCGACGGCCGGGTGCGGCCGGTCCGCGGAGTGCTGCCCGCCGTCCTCGCCGCGGCCGACGCCGGGT
ACCGGCACGTCGTGGTTCCGGAACGCACCGCGGCCGAGGCCTCGCTCGTTCCGGGAGTCTCGGTGCTCGGCATCCGTACC
CTGCGCCAGCTCGTCGCGATCCTCAACGACGAGACGGTCCCGGAAGAGGAGGAAGACCGGGACGAGGGGCGTCCCGACCC
GCTGTTCGCCGGGCTCGCGGTGCCCGGGGCCGGTATGGGCACCGGCGTCTCCGGCCGGGAGGTGGTCCCCGACCTCGCGG
ACGTCGCGGGCCAGCACACCGCCCGGCGTGCCCTGGAGATCTCCGCGGCCGGCGGCCATCACCTGTACCTGAAGGGCCCG
CCGGGCGCCGGAAAGACGATGCTGGCCGAGCGGCTGGCCGGGCTCCTGCCACGGCTCACCGCACAGGAGTCGCTGGAGGT
CACCGCGGTGCACTCGGTCGCCGGGATCCTCCCGCCCGGCAAACCGCTGATCGACACCCCGCCGTACTGCGCCCCGCACC
ACTCGGCGACCATGCCCTCCATCATCGGCGGCGGCAGCGGTCTGCCCAGGCCGGGCGCGGTCTCCCTGGCCCATCGCGGG
GTGCTCTTCCTGGACGAGGCGCCGGAGTTCAGCGGCCGGGTGCTCGACGCGATGCGCCAGCCGCTGGAGTCAGGGCACGT
CGTGGTGGCCCGCTCCGCGGGAGTGATGCGGCTGCCCGCGCGCTTCCTGCTCGCCCTCGCCGCGAACCCCTGTCCGTGCG
GACGGTATTCGCTGCTGGGGCTGGGGTGCGACTGCTCGCCGGCGGCGGTTCGCCGGTACCAGGCGAGACTGTCCGGGCCG
CTCCTGGACCGGGTGGACCTCCGCGTCCAGGTCGAGGCGGTGACCCGTACGGAGCTGATCGAGGGCGCCTCGGGCGCCGA
GCCGAGCGCGCGGGTCGCGGACCGGGTGCGGCTCGCGAGGGAACGGGCGGCGGTCCGGTACGCGGAGACCCCGTGGCGGA
CCAACAGCGAGGTGCCCGGCCATGAGCTGCGCACCCGCTGGCAGGTGGGCCCGGCCGGACTGCGGGAGGCCGAAAGGGAC
ATGGAGCGCGGACTGCTCACCGCCCGGGGCCTGGACCGCGTCCTGCGCGTGGCCTGGACGATCGCCGATCTCGCCGGGGT
CGAACGGCCCGGTCCGCGGGAGATGGCGGAGGCCCTGCAACTGCGCACCGGTGTCGCCCGCGGGGTGCCGGCCGTCGTGG
GCGGTGGCTGA
ATGGGCTTCGCCCGCACCTGCTCGGTGGCCCTGGTCGGCGTGGAGGGCGTGGTCGTCGAGGTCCAGGCCGACCTCGAACC
GGGGCTGGCCGCGTTCACCCTCGTCGGACTGCCCGACAAGAGCCTGAGCGAGAGCCGCGACCGCGTCCGGGCGGCGATCG
TGAACAGCGGAGAGACCTGGCCGCAGAAGAAACTCACCGTGGGCCTCAGCCCCGCCTCGGTCCCCAAGAGCGGCAGCGGC
TTCGATCTCGGGGTCGCGTGCGCGGTCCTCGCCGCCAACGAACGGCTCGCGCCCCGGGCCATCGCCGATCTGATGATGAT
CGGCGAGCTGGGCCTCGACGGCCGGGTGCGGCCGGTCCGCGGAGTGCTGCCCGCCGTCCTCGCCGCGGCCGACGCCGGGT
ACCGGCACGTCGTGGTTCCGGAACGCACCGCGGCCGAGGCCTCGCTCGTTCCGGGAGTCTCGGTGCTCGGCATCCGTACC
CTGCGCCAGCTCGTCGCGATCCTCAACGACGAGACGGTCCCGGAAGAGGAGGAAGACCGGGACGAGGGGCGTCCCGACCC
GCTGTTCGCCGGGCTCGCGGTGCCCGGGGCCGGTATGGGCACCGGCGTCTCCGGCCGGGAGGTGGTCCCCGACCTCGCGG
ACGTCGCGGGCCAGCACACCGCCCGGCGTGCCCTGGAGATCTCCGCGGCCGGCGGCCATCACCTGTACCTGAAGGGCCCG
CCGGGCGCCGGAAAGACGATGCTGGCCGAGCGGCTGGCCGGGCTCCTGCCACGGCTCACCGCACAGGAGTCGCTGGAGGT
CACCGCGGTGCACTCGGTCGCCGGGATCCTCCCGCCCGGCAAACCGCTGATCGACACCCCGCCGTACTGCGCCCCGCACC
ACTCGGCGACCATGCCCTCCATCATCGGCGGCGGCAGCGGTCTGCCCAGGCCGGGCGCGGTCTCCCTGGCCCATCGCGGG
GTGCTCTTCCTGGACGAGGCGCCGGAGTTCAGCGGCCGGGTGCTCGACGCGATGCGCCAGCCGCTGGAGTCAGGGCACGT
CGTGGTGGCCCGCTCCGCGGGAGTGATGCGGCTGCCCGCGCGCTTCCTGCTCGCCCTCGCCGCGAACCCCTGTCCGTGCG
GACGGTATTCGCTGCTGGGGCTGGGGTGCGACTGCTCGCCGGCGGCGGTTCGCCGGTACCAGGCGAGACTGTCCGGGCCG
CTCCTGGACCGGGTGGACCTCCGCGTCCAGGTCGAGGCGGTGACCCGTACGGAGCTGATCGAGGGCGCCTCGGGCGCCGA
GCCGAGCGCGCGGGTCGCGGACCGGGTGCGGCTCGCGAGGGAACGGGCGGCGGTCCGGTACGCGGAGACCCCGTGGCGGA
CCAACAGCGAGGTGCCCGGCCATGAGCTGCGCACCCGCTGGCAGGTGGGCCCGGCCGGACTGCGGGAGGCCGAAAGGGAC
ATGGAGCGCGGACTGCTCACCGCCCGGGGCCTGGACCGCGTCCTGCGCGTGGCCTGGACGATCGCCGATCTCGCCGGGGT
CGAACGGCCCGGTCCGCGGGAGATGGCGGAGGCCCTGCAACTGCGCACCGGTGTCGCCCGCGGGGTGCCGGCCGTCGTGG
GCGGTGGCTGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comM | Vibrio campbellii strain DS40M4 |
40.152 |
98.507 |
0.396 |
| comM | Haemophilus influenzae Rd KW20 |
39.279 |
98.321 |
0.386 |
| comM | Vibrio cholerae O1 biovar El Tor strain E7946 |
39.655 |
97.388 |
0.386 |
| comM | Vibrio cholerae strain A1552 |
39.655 |
97.388 |
0.386 |
| comM | Acinetobacter baylyi ADP1 |
39.197 |
97.575 |
0.382 |
| comM | Legionella pneumophila strain ERS1305867 |
38.068 |
98.507 |
0.375 |
| comM | Legionella pneumophila str. Paris |
38.068 |
98.507 |
0.375 |
| comM | Glaesserella parasuis strain SC1401 |
37.951 |
98.321 |
0.373 |