Detailed information    

insolico Bioinformatically predicted

Overview


Name   rexA   Type   Machinery gene
Locus tag   SPG_1051 Genome accession   CP001015
Coordinates   1013221..1016871 (+) Length   1216 a.a.
NCBI ID   ACF56108.1    Uniprot ID   -
Organism   Streptococcus pneumoniae G54     
Function   homologous recombination (predicted from homology)   
Homologous recombination

Genomic Context


Location: 1008221..1021871
Locus tag Gene name Coordinates (strand) Size (bp) Protein ID Product Description
  SPG_1048 - 1008231..1008677 (-) 447 ACF55886.1 site-specific recombinase, phage integrase family -
  SPG_1049 - 1009094..1009423 (-) 330 ACF55559.1 IS630-Spn1, transposase -
  SPG_1050 rexB 1009949..1013224 (+) 3276 ACF55246.1 exonuclease RexB Machinery gene
  SPG_1051 rexA 1013221..1016871 (+) 3651 ACF56108.1 exonuclease RexA Machinery gene
  SPG_1052 - 1017266..1018444 (+) 1179 ACF56031.1 conserved hypothetical protein -

Sequence


Protein


Download         Length: 1216 a.a.        Molecular weight: 140300.00 Da        Isoelectric Point: 5.3518

>NTDB_id=20359 SPG_1051 ACF56108.1 1013221..1016871(+) (rexA) [Streptococcus pneumoniae G54]
MKLIPFLSEEEIQKLQEAEANSSKEQKKTAEQIEAIYTSGQNILVSASAGSGKTFVMVERILDQLARGVEISQLFISTFT
VKAATELKERLEKKISKKIQETDDVDLKQHLGRQLADLPNAAIGTMDSFTQKFLGKHGYLLDIAPNFRILQNQSEQLLLE
NEVFHEVFEAHYQGKQKESFSHLLKNFAGRGKDERGLRQQVYKIYDFLQSTSNPQKWLSESFLKGFEKADFTSEKEKLTE
QIKQALWDLESFFRYHLDNDAKEFAKAAYLENVQLILDEIGSLNQEFDSQAYQAVLARVVAISKEKNGRALTNASRKADL
KPLADAYNEERKTQFTKLGQLSDQIAILDYQERYHGDTWKLAKTFQSFMSDFVEAYRQRKRQENAFEFADISHYTIEILE
NFPQVRESYQERFHEVMVDEYQDINHIQERMLELLSNGHNRFMVGDIKQSIYRFRQADPQIFNEKFQRYAQNPQEGKLIL
LKENFRSSSEVLSATNDVFERLMDQEVGEINYDNMHQLVFANTKLTPNPDNKAEFLLYDKDDTGEEEESQTETKLTGEMR
LVIKEILKLHQEKGVAFKEIALLTSSRNRNDQILLALSEYGIPVKTDGEQNNYLQSLEVQVMLDTLRVIHNPLQDYALVA
LMKSPMFGFDEDELARLSLQKAEDKAHENLYEKLVNAQKKASSQKGLIHTALAEKLKQFMDILASWRLYAKPHSLYDLIW
KIYNDRFYYDYVGALPNGPARQANLYALALRADQFEKSNFKGLSRFIRMIDQVLEAQHDLASVAVAPPKDAVELMTIHKS
KGLEFPYVFILNMDQDFNKQDSMSEVILSRQNGLGVKYIAKMETGAVEDHYPKTIKLSIPSLTYRQNEEELQLASYSEQM
RLLYVAMTRAEKKLYLVGKGSREKLESKEYPAAKNGKLNSNTRLQARNFQDWLWAISKVFTKDKLNFSYRFIGEDQLTRE
AIGELETKSPLQDSSQADNRQSDTIKEALEMLKEVEVYNTLHRAAIELPSVQTPSQIKKFYEPVMDMEGVEIAGQGQSVG
KKISFDLPDFSTKEKVTGAEIGSATHELMQRIDLSQQLTLASLTETLKQVQTSQAVRDKINLDKILAFFDTALGQEIFAN
TDHLYREQPFSMLKRDQKSQEDFVVRGILDGYLLYENKIVLFDYKTDRYDEPSQLVDRYRGQLALYEEALSRAYSIENIE
KYLILLGKDEVQVVKV

Nucleotide


Download         Length: 3651 bp        

>NTDB_id=20359 SPG_1051 ACF56108.1 1013221..1016871(+) (rexA) [Streptococcus pneumoniae G54]
ATGAAGCTTATTCCCTTTTTAAGTGAGGAGGAGATTCAAAAACTGCAAGAAGCAGAAGCAAATTCGAGCAAGGAACAGAA
GAAAACTGCCGAACAAATCGAAGCTATCTACACTTCTGGTCAGAATATCCTGGTCTCAGCATCGGCTGGTTCTGGAAAGA
CCTTTGTCATGGTAGAGCGCATTCTGGACCAATTGGCGCGTGGTGTCGAAATTTCTCAACTCTTTATCTCAACCTTTACC
GTCAAGGCTGCAACTGAACTTAAAGAACGTTTAGAGAAAAAAATCAGCAAGAAAATCCAAGAAACAGATGATGTCGATCT
CAAACAACACTTGGGTCGCCAGTTGGCAGACCTACCCAACGCTGCCATCGGAACCATGGACTCTTTCACACAAAAATTCC
TTGGCAAACATGGTTATCTGCTTGATATTGCACCTAATTTCCGTATTTTACAAAACCAAAGCGAGCAACTTCTTCTCGAA
AACGAAGTCTTTCATGAGGTCTTTGAAGCGCATTACCAAGGTAAACAGAAAGAGAGCTTTAGTCATTTGCTGAAAAACTT
TGCTGGGCGTGGCAAGGACGAACGGGGTCTGCGGCAGCAAGTCTATAAAATCTATGACTTCCTCCAATCCACCAGTAATC
CTCAAAAGTGGCTGAGTGAATCTTTCCTCAAAGGCTTTGAGAAAGCTGATTTTACCAGTGAAAAAGAAAAACTGACTGAG
CAAATCAAACAAGCCCTCTGGGATTTGGAAAGCTTTTTCCGTTACCATCTGGATAACGATGCCAAGGAGTTTGCAAAGGC
TGCCTATTTAGAAAATGTTCAGTTAATTCTGGATGAAATTGGCTCCCTAAATCAGGAGTTCGATAGTCAGGCTTATCAGG
CAGTACTTGCGCGTGTTGTCGCCATCTCTAAGGAGAAAAACGGTCGAGCTCTGACTAATGCCAGCCGTAAGGCTGATTTG
AAGCCCCTGGCTGATGCCTACAACGAAGAGAGAAAGACCCAGTTTACTAAACTAGGACAATTATCAGACCAGATAGCGAT
TCTCGACTATCAAGAACGTTATCATGGAGACACTTGGAAACTAGCTAAAACCTTCCAATCTTTCATGAGCGATTTTGTAG
AGGCTTATCGTCAGAGAAAACGACAGGAAAATGCCTTTGAATTCGCTGATATCAGCCATTACACCATTGAGATTTTAGAA
AATTTCCCACAAGTTCGTGAGTCTTATCAGGAGCGCTTCCATGAAGTCATGGTCGATGAGTATCAGGATATCAACCATAT
TCAAGAACGGATGCTGGAATTGTTGTCTAATGGCCACAATCGCTTTATGGTGGGAGATATCAAGCAATCCATCTATCGTT
TCCGTCAGGCAGACCCGCAGATTTTCAATGAGAAATTCCAACGCTATGCGCAAAATCCTCAAGAAGGCAAGCTCATTCTC
CTCAAGGAAAATTTCCGTAGTAGTTCAGAAGTGCTGTCAGCAACCAATGATGTCTTTGAACGTCTCATGGACCAAGAGGT
CGGCGAAATCAACTATGATAACATGCACCAGCTTGTTTTTGCCAATACCAAACTGACTCCCAATCCAGACAACAAGGCCG
AATTTCTCCTCTACGACAAGGACGATACAGGTGAGGAAGAAGAGAGTCAAACAGAAACGAAACTAACAGGCGAAATGCGC
TTAGTTATCAAGGAGATCCTTAAACTTCATCAGGAAAAAGGTGTTGCCTTTAAGGAAATTGCCCTTCTGACCTCTAGTCG
TAATCGTAATGACCAAATTCTACTTGCCCTGTCTGAGTACGGGATTCCTGTCAAAACTGACGGAGAGCAAAACAATTATC
TCCAATCCCTAGAAGTGCAAGTCATGCTAGACACCCTTCGTGTCATTCACAATCCCCTGCAAGACTACGCCTTGGTTGCC
CTTATGAAGTCTCCAATGTTTGGTTTTGATGAGGATGAGCTAGCACGTTTGTCCCTTCAGAAAGCAGAGGATAAAGCCCA
CGAAAATCTCTATGAGAAACTAGTCAATGCACAAAAAAAGGCAAGTAGTCAAAAAGGCTTGATTCACACAGCTCTAGCTG
AAAAACTAAAGCAATTCATGGATATCCTAGCTTCTTGGCGCTTGTATGCCAAACCCCACTCTCTCTATGACTTGATTTGG
AAGATTTACAACGACCGTTTTTATTATGACTATGTTGGGGCTTTGCCGAATGGTCCTGCTAGGCAGGCCAATCTCTATGC
CCTAGCACTGCGTGCTGATCAATTTGAAAAGAGCAATTTCAAAGGTTTGTCGCGTTTTATTCGTATGATTGACCAAGTCT
TAGAAGCCCAGCACGATTTGGCAAGCGTGGCCGTCGCACCGCCAAAAGATGCAGTAGAGCTCATGACCATCCACAAGAGT
AAAGGGCTGGAGTTTCCTTACGTCTTTATCCTCAATATGGATCAAGATTTCAACAAACAAGACTCTATGTCAGAAGTCAT
TCTCAGTCGTCAGAATGGTCTTGGTGTCAAATATATTGCCAAGATGGAGACAGGGGCAGTAGAAGACCACTATCCTAAAA
CCATCAAACTCTCCATTCCTAGTCTGACCTATAGGCAGAACGAAGAGGAATTACAGCTAGCAAGCTATTCTGAGCAGATG
CGTTTGCTGTATGTTGCTATGACGCGGGCTGAGAAAAAGCTCTATCTTGTCGGCAAGGGTTCTCGTGAAAAGCTGGAATC
CAAGGAATACCCAGCAGCCAAAAATGGGAAACTAAATAGCAATACTAGACTGCAAGCACGGAATTTCCAAGATTGGCTTT
GGGCTATCAGTAAAGTGTTTACTAAGGACAAGCTCAACTTTAGTTATCGTTTTATTGGCGAAGATCAGTTGACCAGAGAA
GCTATCGGAGAGTTGGAAACCAAGAGTCCTCTCCAAGATAGCTCCCAAGCAGACAATCGTCAGTCAGATACCATCAAAGA
AGCTCTGGAAATGCTGAAGGAGGTGGAAGTTTATAATACTCTTCACCGCGCAGCTATTGAACTTCCTAGTGTTCAAACCC
CAAGTCAAATCAAGAAATTCTACGAACCAGTTATGGATATGGAAGGTGTCGAGATTGCTGGTCAAGGTCAGTCAGTAGGC
AAGAAAATCAGCTTCGATTTGCCAGATTTTTCAACCAAAGAAAAGGTAACTGGAGCTGAGATTGGTAGTGCTACTCACGA
ACTCATGCAGAGAATTGACCTCAGCCAGCAACTAACCCTTGCTAGCCTAACAGAAACACTCAAACAAGTTCAAACTAGCC
AAGCTGTCAGAGACAAGATCAATCTTGATAAAATTCTTGCTTTCTTTGACACAGCACTCGGTCAGGAAATTTTTGCTAAT
ACCGACCATCTCTATCGCGAGCAACCTTTCTCCATGCTCAAACGAGACCAAAAGAGTCAGGAAGACTTTGTTGTCCGTGG
TATCCTTGATGGCTATCTGCTTTACGAAAACAAAATTGTTTTGTTCGACTACAAGACAGACCGCTATGATGAACCAAGTC
AACTCGTAGACCGCTATCGTGGTCAGTTAGCTCTATACGAAGAGGCTTTATCACGAGCCTATTCGATTGAAAATATTGAA
AAATACTTGATTTTACTCGGTAAAGACGAGGTTCAAGTTGTAAAAGTATAA


Secondary structure


Protein secondary structures were predicted by S4PRED and visualized by seqviz.



3D structure


Source ID Structure

Transmembrane helices


Transmembrane helices of protein were predicted by TMHMM 2.0 and visualized by seqviz and ECharts.



Visualization of predicted probability:


Similar proteins


Only experimentally validated proteins are listed.

Protein Organism Identities (%) Coverage (%) Ha-value
  rexA Streptococcus pneumoniae R6

98.602

100

0.986


Multiple sequence alignment