Detailed information    

insolico Bioinformatically predicted

Overview


Name   recP/tkt   Type   Machinery gene
Locus tag   NO473_RS20705 Genome accession   NZ_CP101666
Coordinates   4262304..4264307 (-) Length   667 a.a.
NCBI ID   WP_000087280.1    Uniprot ID   P33570
Organism   Escherichia coli strain M171-1     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 4257304..4269307
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  NO473_RS20690 aegA 4258418..4260397 (+) 1980 WP_001078880.1 formate-dependent uric acid utilization protein AegA -
  NO473_RS20695 nudK 4260465..4261040 (+) 576 WP_001300814.1 GDP-mannose pyrophosphatase NudK -
  NO473_RS20700 ypfG 4261166..4262209 (+) 1044 WP_001270542.1 DUF1176 domain-containing protein -
  NO473_RS20705 recP/tkt 4262304..4264307 (-) 2004 WP_000087280.1 transketolase Machinery gene
  NO473_RS20710 tal 4264327..4265277 (-) 951 WP_001003709.1 transaldolase -
  NO473_RS20715 maeB 4265566..4267845 (+) 2280 WP_000342644.1 NADP-dependent oxaloacetate-decarboxylating malate dehydrogenase -
  NO473_RS20720 eutS 4268138..4268473 (+) 336 WP_000356956.1 ethanolamine utilization microcompartment protein EutS -
  NO473_RS20725 eutP 4268486..4268965 (+) 480 WP_000820762.1 ethanolamine utilization acetate kinase EutP -

Sequence


Protein


Download         Length: 667 a.a.        Molecular weight: 73042.72 Da        Isoelectric Point: 6.2536

>NTDB_id=611601 NO473_RS20705 WP_000087280.1 4262304..4264307(-) (recP/tkt) [Escherichia coli strain M171-1]
MSRKDLANAIRALSMDAVQKANSGHPGAPMGMADIAEVLWNDFLKHNPTDPTWYDRDRFILSNGHASMLLYSLLHLTGYD
LPLEELKNFRQLHSKTPGHPEIGYTPGVETTTGPLGQGLANAVGLAIAERTLAAQFNQPDHEIVDHFTYVFMGDGCLMEG
ISHEVCSLAGTLGLGKLIGFYDHNGISIDGETEGWFTDDTAKRFEAYHWHVIHEIDGHDPQAVKEAILEAQSVKDKPSLI
ICRTVIGFGSPNKAGKEEAHGAPLGEEEVALARQKLGWHHPPFEIPKEIYHAWDAREKGEKAQQSWNEKFAAYKKAHPQL
AEEFTRRMSGGLPKDWEKTTQKYINELQANPAKIATRKASQNTLNAYGPMLPELLGGSADLAPSNLTIWKGSVSLKEDPA
GNYIHYGVREFGMTAIANGIAHHGGFVPYTATFLMFVEYARNAARMAALMKARQIMVYTHDSIGLGEDGPTHQAVEQLAS
LRLTPNFSTWRPCDQVEAAVGWKLAVERHNGPTALILSRQNLAQVERTPDQVKEIARGGYVLKDSGGKPDIILIATGSEM
EITLQAAEKLAGEGRNVRVVSLPSTDIFDAQDEEYRESVLPSNVAARVAVEAGIADYWYKYVGLKGAIVGMTGYGESAPA
DKLFPFFGFTAENIVAKAHKVLGVKGA

Nucleotide


Download         Length: 2004 bp        

>NTDB_id=611601 NO473_RS20705 WP_000087280.1 4262304..4264307(-) (recP/tkt) [Escherichia coli strain M171-1]
ATGTCCCGAAAAGACCTTGCCAATGCGATTCGCGCACTCAGTATGGATGCGGTACAAAAAGCCAACTCTGGTCATCCCGG
CGCGCCGATGGGCATGGCTGATATTGCCGAAGTGCTGTGGAACGATTTTCTTAAACATAACCCTACCGACCCAACCTGGT
ATGATCGCGACCGCTTTATTCTTTCCAACGGTCACGCGTCGATGCTGCTCTACAGTTTGCTACATCTGACCGGTTACGAC
CTGCCGCTGGAAGAACTGAAGAACTTCCGTCAGTTGCATTCGAAAACCCCAGGCCACCCGGAGATTGGCTATACGCCAGG
CGTTGAAACCACCACCGGCCCGCTTGGACAAGGTTTGGCGAACGCCGTCGGGCTGGCGATAGCAGAGCGTACACTGGCGG
CGCAGTTTAACCAGCCAGACCATGAGATCGTCGATCACTTCACCTATGTGTTTATGGGCGACGGCTGCCTGATGGAAGGT
ATTTCCCACGAAGTCTGTTCGCTGGCAGGCACGCTGGGACTGGGCAAGCTGATTGGTTTTTACGATCACAACGGTATTTC
CATCGACGGTGAAACAGAAGGCTGGTTTACCGACGATACGGCAAAACGTTTTGAAGCCTATCACTGGCATGTGATCCATG
AAATCGACGGTCACGATCCGCAGGCGGTGAAGGAAGCGATCCTTGAAGCGCAAAGCGTGAAAGATAAGCCGTCGCTGATT
ATCTGCCGTACGGTGATTGGCTTTGGTTCGCCGAATAAAGCAGGTAAGGAAGAGGCGCACGGCGCACCACTGGGGGAAGA
AGAAGTGGCGCTGGCACGGCAAAAACTGGGCTGGCACCATCCGCCATTTGAGATCCCTAAAGAGATTTATCACGCCTGGG
ATGCCCGTGAAAAAGGCGAAAAAGCGCAGCAGAGCTGGAATGAGAAGTTTGCCGCCTATAAAAAGGCTCATCCGCAACTG
GCAGAAGAGTTTACCCGACGGATGAGCGGTGGTTTACCGAAGGACTGGGAGAAAACGACTCAGAAATATATCAATGAGTT
ACAGGCAAATCCGGCGAAAATCGCTACCCGTAAGGCTTCGCAAAATACGCTTAACGCTTACGGGCCGATGCTGCCTGAGT
TGCTCGGCGGTTCGGCGGATCTGGCTCCCAGCAACCTGACCATCTGGAAAGGTTCTGTTTCGCTGAAGGAAGATCCAGCG
GGCAACTACATTCACTACGGGGTGCGTGAATTTGGCATGACCGCTATCGCCAACGGCATCGCGCACCACGGCGGCTTTGT
GCCGTATACCGCGACGTTCCTGATGTTTGTTGAATACGCCCGTAACGCCGCGCGGATGGCGGCACTGATGAAAGCGCGGC
AGATTATGGTTTATACCCACGACTCAATTGGCCTGGGCGAAGATGGTCCGACGCACCAGGCTGTTGAGCAACTGGCCAGC
CTGCGCTTAACGCCAAATTTCAGCACCTGGCGACCGTGCGATCAGGTGGAAGCGGCGGTGGGCTGGAAGCTGGCGGTTGA
GCGCCACAACGGACCGACGGCACTGATCCTCTCAAGGCAGAATCTGGCCCAGGTGGAACGTACGCCGGATCAGGTTAAAG
AGATTGCTCGTGGCGGTTATGTGCTGAAAGACAGCGGCGGTAAGCCAGATATTATTCTGATTGCCACCGGTTCAGAGATG
GAAATTACCCTGCAAGCGGCAGAGAAATTAGCAGGAGAAGGTCGCAATGTACGCGTAGTTTCCCTGCCCTCGACCGATAT
TTTCGACGCCCAGGATGAGGAATATCGGGAGTCGGTGTTGCCTTCTAACGTTGCGGCTCGCGTGGCGGTGGAAGCAGGTA
TTGCCGATTACTGGTACAAGTATGTTGGTCTGAAAGGGGCAATTGTCGGGATGACGGGTTACGGGGAATCTGCTCCGGCG
GATAAGCTGTTCCCGTTCTTTGGCTTTACCGCCGAGAATATTGTGGCAAAAGCGCATAAGGTGCTGGGAGTGAAAGGTGC
CTGA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure
  AlphaFold DB P33570

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  recP/tkt Streptococcus pneumoniae TIGR4

47.496

98.801

0.469