Detailed information    

insolico Bioinformatically predicted

Overview


Name   comM   Type   Machinery gene
Locus tag   GQS52_RS07035 Genome accession   NZ_CP046907
Coordinates   1631796..1633412 (-) Length   538 a.a.
NCBI ID   WP_182312435.1    Uniprot ID   -
Organism   Streptomyces sp. SCUT-3     
Function   DNA uptake (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1626796..1638412
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  GQS52_RS27580 - 1627799..1628530 (+) 732 Protein_1433 M23 family metallopeptidase -
  GQS52_RS07020 (GQS52_07020) - 1628938..1629477 (-) 540 WP_182316268.1 TetR/AcrR family transcriptional regulator -
  GQS52_RS07025 (GQS52_07025) whiG 1629570..1630391 (-) 822 WP_182312431.1 RNA polymerase sigma factor WhiG -
  GQS52_RS07030 (GQS52_07030) dprA 1630570..1631742 (-) 1173 WP_259371058.1 DNA-processing protein DprA -
  GQS52_RS07035 (GQS52_07035) comM 1631796..1633412 (-) 1617 WP_182312435.1 YifB family Mg chelatase-like AAA ATPase Machinery gene
  GQS52_RS07040 (GQS52_07040) - 1633412..1633771 (-) 360 WP_182312437.1 YraN family protein -
  GQS52_RS07045 (GQS52_07045) - 1633964..1634290 (-) 327 WP_182312439.1 DUF2469 domain-containing protein -
  GQS52_RS07050 (GQS52_07050) - 1634330..1634809 (-) 480 WP_259371059.1 NUDIX hydrolase -
  GQS52_RS07055 (GQS52_07055) lepB 1634892..1635653 (-) 762 WP_182312443.1 signal peptidase I -
  GQS52_RS07060 (GQS52_07060) lepB 1635686..1636624 (-) 939 WP_182312445.1 signal peptidase I -
  GQS52_RS07065 (GQS52_07065) lepB 1636545..1637558 (-) 1014 WP_182312447.1 signal peptidase I -
  GQS52_RS07070 (GQS52_07070) lepB 1637551..1638297 (-) 747 WP_182312449.1 signal peptidase I -

Sequence


Protein


Download         Length: 538 a.a.        Molecular weight: 55682.10 Da        Isoelectric Point: 7.6963

>NTDB_id=356700 GQS52_RS07035 WP_182312435.1 1631796..1633412(-) (comM) [Streptomyces sp. SCUT-3]
MGLGCTCAVALVGVEGVMVEVQAGLEAGIATFTLVGLPDKSLSEARDRVRAAVANSGEEWPQRKLTVGLSPASVPKSGSG
FDLAIACAVLAAAERIRPEAIAGLMMVGELGLDGRVRPVRGVLPAVLAAAEAGHRQVVVPECSVPEASLVPGVTVVGVRS
LRGLIALLNDEPPPEEGPAAEPGGPDPLTAGLSLPGASLGAGAAGPSRAHRPDMSQVAGQHEARRALEVAAAGGHHLFLS
GPPGAGKTMLAERLPGLLPPLSDREALEVTAVHSVAGLLPPGRPLLTEAPYCAPHHSATMPSVVGGGSGMPRPGAVSLAH
RGVLFLDEAPEFSSRVLDSLRQPLESGHVVVARAAGMMQLPAKFLLVLAANPCPCGRFDRELGGCECPPATVRRYRARLS
GPLLDRIDLRLEVAPLARSELVRHHEGAEPSSAVAARVRAARERAAARYDGTPWTVNSAVPGHELRTRWRVADGALAPAE
RDLERGLLTARGLDRVLRVAWTVADLAGHPAPTREDVLTALELRTGVRRGLTAAGGPR

Nucleotide


Download         Length: 1617 bp        

>NTDB_id=356700 GQS52_RS07035 WP_182312435.1 1631796..1633412(-) (comM) [Streptomyces sp. SCUT-3]
ATGGGCCTGGGATGCACCTGCGCGGTGGCCCTGGTCGGGGTGGAGGGCGTCATGGTCGAGGTCCAGGCGGGCCTGGAGGC
GGGCATCGCCACCTTCACCCTGGTCGGCCTCCCCGACAAGAGCCTGTCCGAGGCCCGGGACCGGGTGCGCGCGGCGGTCG
CCAACAGCGGCGAGGAATGGCCGCAGCGCAAACTCACCGTCGGGCTGAGCCCGGCCTCCGTGCCCAAGAGCGGCAGCGGT
TTCGATTTGGCCATCGCCTGCGCGGTCCTGGCCGCCGCCGAGCGGATCCGTCCCGAGGCGATCGCCGGACTGATGATGGT
CGGCGAGCTGGGGCTGGACGGCCGGGTGCGCCCCGTGCGGGGAGTCCTGCCGGCCGTGCTCGCGGCGGCCGAGGCCGGCC
ACCGGCAGGTCGTCGTGCCCGAGTGCAGCGTCCCGGAGGCGTCCCTGGTCCCTGGCGTCACCGTCGTGGGAGTGCGCAGC
CTGCGCGGGCTGATCGCCCTCCTCAACGACGAGCCGCCGCCGGAGGAGGGACCCGCCGCCGAACCGGGCGGCCCCGACCC
GCTGACGGCCGGCCTGAGCCTGCCCGGCGCCTCCCTCGGCGCCGGCGCGGCGGGGCCGTCCCGCGCCCACCGCCCGGACA
TGTCCCAGGTGGCCGGCCAGCACGAGGCCCGACGGGCACTGGAGGTGGCCGCGGCAGGCGGCCACCACCTCTTCCTCTCC
GGTCCCCCCGGAGCCGGCAAGACCATGCTCGCCGAGCGGCTGCCGGGCCTGCTGCCACCGCTGAGCGACCGGGAGGCACT
GGAGGTGACCGCGGTCCACTCGGTGGCCGGGCTGCTGCCCCCGGGGCGGCCGCTGCTCACCGAGGCGCCGTACTGCGCCC
CGCACCACTCGGCGACCATGCCATCGGTCGTCGGGGGCGGCAGCGGGATGCCGCGACCCGGCGCGGTCTCACTCGCCCAC
CGGGGCGTGCTGTTCCTGGACGAGGCGCCCGAGTTCAGCAGCCGGGTGCTGGACTCGCTGCGCCAGCCGCTGGAGTCGGG
ACACGTGGTGGTCGCCCGCGCGGCGGGCATGATGCAGCTGCCCGCGAAGTTCCTGCTGGTGCTCGCGGCCAACCCGTGTC
CGTGCGGCCGCTTCGACCGGGAGCTGGGAGGCTGCGAGTGCCCGCCGGCCACCGTGCGGCGCTACCGGGCCAGACTGTCC
GGGCCGCTGCTGGACCGGATCGACCTCAGGCTGGAGGTCGCCCCGCTCGCGCGCTCGGAACTGGTGCGCCACCACGAGGG
GGCCGAACCGTCGTCCGCGGTGGCGGCCCGGGTGCGGGCGGCCCGCGAGCGCGCCGCGGCCCGCTACGACGGAACGCCGT
GGACGGTCAACAGCGCCGTGCCCGGGCACGAGCTGCGCACCCGGTGGCGGGTCGCGGACGGAGCGCTGGCCCCGGCCGAG
CGCGACCTGGAGCGCGGCCTGCTCACCGCGCGCGGCCTGGACCGCGTACTGCGCGTCGCCTGGACCGTGGCCGATCTGGC
CGGCCACCCGGCGCCGACCCGTGAGGACGTCCTGACGGCGCTGGAGCTGCGCACCGGCGTGCGCAGGGGGCTCACCGCGG
CGGGAGGCCCCCGGTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comM Vibrio campbellii strain DS40M4

40.561

99.442

0.403

  comM Vibrio cholerae O1 biovar El Tor strain E7946

40.076

97.398

0.39

  comM Vibrio cholerae strain A1552

40.076

97.398

0.39

  comM Legionella pneumophila strain ERS1305867

38.404

100

0.385

  comM Legionella pneumophila str. Paris

38.404

100

0.385

  comM Haemophilus influenzae Rd KW20

38.185

98.327

0.375

  comM Glaesserella parasuis strain SC1401

38.477

95.167

0.366

  comM Acinetobacter baylyi ADP1

37.311

98.141

0.366