Detailed information    

insolico Bioinformatically predicted

Overview


Name   comE1/comEA   Type   Machinery gene
Locus tag   AVCA_RS09185 Genome accession   NC_021149
Coordinates   1995520..1995852 (+) Length   110 a.a.
NCBI ID   WP_012700623.1    Uniprot ID   C1DEM9
Organism   Azotobacter vinelandii CA     
Function   dsDNA binding (predicted from homology)   
DNA binding and uptake

Genomic Context


Location: 1990520..2000852
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  AVCA_RS09165 (AvCA_20030) - 1990888..1991115 (+) 228 WP_012700619.1 hypothetical protein -
  AVCA_RS09170 (AvCA_20040) acnA 1991112..1993799 (-) 2688 WP_012700620.1 aconitate hydratase AcnA -
  AVCA_RS09175 (AvCA_20050) rlmM 1993977..1995038 (+) 1062 WP_012700621.1 23S rRNA (cytidine(2498)-2'-O)-methyltransferase RlmM -
  AVCA_RS09180 (AvCA_20060) tusA 1995091..1995348 (+) 258 WP_012700622.1 sulfurtransferase TusA -
  AVCA_RS09185 (AvCA_20070) comE1/comEA 1995520..1995852 (+) 333 WP_012700623.1 ComEA family DNA-binding protein Machinery gene
  AVCA_RS09195 (AvCA_20090) - 1996177..1997373 (-) 1197 WP_012700624.1 amino acid aminotransferase -
  AVCA_RS09200 (AvCA_20100) uvrB 1997671..1999680 (+) 2010 WP_012700625.1 excinuclease ABC subunit UvrB Machinery gene

Sequence


Protein


Download         Length: 110 a.a.        Molecular weight: 11331.04 Da        Isoelectric Point: 8.6190

>NTDB_id=48348 AVCA_RS09185 WP_012700623.1 1995520..1995852(+) (comE1/comEA) [Azotobacter vinelandii CA]
MRKNPFFTLLLALLASVSVAASAAEAPKTGGAKPATVQPAQPVATVKVDLNAADAATLERDLLGIGPAKAQAIVDYRQAH
GPFASVDELLEVKGIGAAILDKNRDRLSAN

Nucleotide


Download         Length: 333 bp        

>NTDB_id=48348 AVCA_RS09185 WP_012700623.1 1995520..1995852(+) (comE1/comEA) [Azotobacter vinelandii CA]
ATGCGCAAGAACCCGTTTTTCACCCTCCTGCTGGCTCTGCTGGCCAGCGTTTCCGTCGCCGCCTCGGCCGCGGAGGCGCC
CAAGACCGGGGGGGCCAAGCCCGCCACGGTCCAGCCTGCCCAGCCGGTTGCCACGGTCAAGGTCGATCTCAATGCCGCCG
ATGCGGCAACGCTCGAGCGCGACCTGCTGGGAATCGGCCCCGCCAAGGCCCAGGCCATCGTCGATTATCGTCAGGCCCAC
GGGCCTTTCGCATCGGTGGACGAACTGCTGGAGGTCAAGGGAATCGGTGCTGCGATACTGGACAAGAACCGCGATCGCTT
GAGCGCCAACTGA

Domains


Predicted by InterProScan.

(43-107)


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB C1DEM9

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  comE1/comEA Haemophilus influenzae Rd KW20

39.655

100

0.418

  comEA/comE1 Glaesserella parasuis strain SC1401

42.308

94.545

0.4

  comEA Vibrio cholerae strain A1552

39.623

96.364

0.382

  comEA Vibrio cholerae C6706

39.623

96.364

0.382

  comEA Vibrio parahaemolyticus RIMD 2210633

40.196

92.727

0.373

  comEA Vibrio campbellii strain DS40M4

39.216

92.727

0.364

  comEA Acinetobacter baumannii strain A118

31.25

100

0.364


Multiple sequence alignment