Detailed information
Overview
| Name | comA | Type | Machinery gene |
| Locus tag | GB851_RS07230 | Genome accession | NZ_CP045141 |
| Coordinates | 1394349..1396634 (+) | Length | 761 a.a. |
| NCBI ID | WP_164538254.1 | Uniprot ID | - |
| Organism | Kingella kingae strain F41215CHC | ||
| Function | DNA processing; DNA transport into the cytoplasm (predicted from homology) DNA processing DNA binding and uptake |
||
Genomic Context
Location: 1389349..1401634
| Locus tag | Gene name | Coordinates (strand) | Size (bp) | Protein ID | Product | Description |
|---|---|---|---|---|---|---|
| GB851_RS07210 (GB851_07400) | - | 1389908..1390822 (+) | 915 | WP_038304087.1 | GTP-binding protein | - |
| GB851_RS07215 (GB851_07405) | - | 1390977..1393058 (+) | 2082 | WP_164538253.1 | carbon starvation CstA family protein | - |
| GB851_RS07220 (GB851_07410) | - | 1393066..1393260 (+) | 195 | WP_026036281.1 | YbdD/YjiX family protein | - |
| GB851_RS07225 (GB851_07415) | - | 1393347..1394171 (+) | 825 | WP_003787625.1 | pyruvate, water dikinase regulatory protein | - |
| GB851_RS07230 (GB851_07420) | comA | 1394349..1396634 (+) | 2286 | WP_164538254.1 | DNA internalization-related competence protein ComEC/Rec2 | Machinery gene |
| GB851_RS07235 | - | 1396668..1396817 (+) | 150 | WP_164538255.1 | hypothetical protein | - |
| GB851_RS07240 (GB851_07430) | msbA | 1397000..1398850 (+) | 1851 | WP_164538256.1 | lipid A export permease/ATP-binding protein MsbA | - |
| GB851_RS07245 (GB851_07440) | dinB | 1399059..1400108 (-) | 1050 | WP_038311328.1 | DNA polymerase IV | - |
Sequence
Protein
Download Length: 761 a.a. Molecular weight: 83835.02 Da Isoelectric Point: 9.2972
>NTDB_id=343714 GB851_RS07230 WP_164538254.1 1394349..1396634(+) (comA) [Kingella kingae strain F41215CHC]
MPPTRYLAAFCIGAISSFYLPEQGNVWAWCVGLLLCAGLAFCLRRVAWQQKAACTFLCLLLGAMYAIGRTEIALSQSQAY
PAQLYPTSQTIRVQVTGLPETDENGRTRFIGIAQTANQQNYRVLFQDYYARDWRVSDVWQTTARIRAAVATRNPVGFDRE
AWALANGIDGMASLGKERKAVAVSTKSSLHFFNQLRANIVQTWQRNASADYPQGVGLMTALAVGNRSDLSQAAWDSFRPL
GLNHLISISGLHISMVGVLAAWLAQRCMRLLPVLPARPKVISIVVGWLAAVVYTGLAGWEIPALRSLIMLTVWAIAWLAR
GHWGVWQTWWAACTAVLLYQPTSVLAVGFWLSFGLVGALLWALSCRLPSRPKPYDTLRQAFIGQWAATLVGGIATIFLFG
ILAVYSPLVNAVAIPFFSSILTPLALVASALPFAPLQRLAAWLGEHTIHILLALSRHLPEQAFAQPPSFLFWLTIFSTLI
ILLPRGTALKPLACVIIASFLLYTPPAPRAPLAVHVWDVGQGLSVLLQTRHHNLLFDTGTPAAEMALLPNLRALGIQQID
TLVLSHHDNDHDGGYAALHRAMPIRQTWAGQPAHYANAKLCTHGTNWQQDGVWFEFLTPNTQSDNDNDQSCVLRIVAGEQ
ALLIMGDVGNDGETALLRQYGEQLASQVLVLGHHGSKSSSHARFLDHIAPSVAIASSGFANHFRHPHPDVQQRLASRQIA
LWRTDTQGSLHFELGNHRAIELIEQQKKWWQRKPFAAPPPS
MPPTRYLAAFCIGAISSFYLPEQGNVWAWCVGLLLCAGLAFCLRRVAWQQKAACTFLCLLLGAMYAIGRTEIALSQSQAY
PAQLYPTSQTIRVQVTGLPETDENGRTRFIGIAQTANQQNYRVLFQDYYARDWRVSDVWQTTARIRAAVATRNPVGFDRE
AWALANGIDGMASLGKERKAVAVSTKSSLHFFNQLRANIVQTWQRNASADYPQGVGLMTALAVGNRSDLSQAAWDSFRPL
GLNHLISISGLHISMVGVLAAWLAQRCMRLLPVLPARPKVISIVVGWLAAVVYTGLAGWEIPALRSLIMLTVWAIAWLAR
GHWGVWQTWWAACTAVLLYQPTSVLAVGFWLSFGLVGALLWALSCRLPSRPKPYDTLRQAFIGQWAATLVGGIATIFLFG
ILAVYSPLVNAVAIPFFSSILTPLALVASALPFAPLQRLAAWLGEHTIHILLALSRHLPEQAFAQPPSFLFWLTIFSTLI
ILLPRGTALKPLACVIIASFLLYTPPAPRAPLAVHVWDVGQGLSVLLQTRHHNLLFDTGTPAAEMALLPNLRALGIQQID
TLVLSHHDNDHDGGYAALHRAMPIRQTWAGQPAHYANAKLCTHGTNWQQDGVWFEFLTPNTQSDNDNDQSCVLRIVAGEQ
ALLIMGDVGNDGETALLRQYGEQLASQVLVLGHHGSKSSSHARFLDHIAPSVAIASSGFANHFRHPHPDVQQRLASRQIA
LWRTDTQGSLHFELGNHRAIELIEQQKKWWQRKPFAAPPPS
Nucleotide
Download Length: 2286 bp
>NTDB_id=343714 GB851_RS07230 WP_164538254.1 1394349..1396634(+) (comA) [Kingella kingae strain F41215CHC]
ATGCCCCCAACACGCTACTTGGCTGCCTTTTGCATTGGCGCGATAAGCAGTTTTTATTTGCCCGAACAAGGCAATGTGTG
GGCGTGGTGTGTGGGTTTGCTATTGTGTGCAGGTTTGGCTTTTTGTTTACGCCGTGTCGCGTGGCAACAAAAAGCAGCCT
GCACTTTTTTGTGCCTACTTTTGGGCGCGATGTATGCCATTGGGCGCACCGAAATCGCGCTATCGCAATCGCAAGCCTAT
CCAGCACAACTGTATCCGACTTCGCAAACGATTCGCGTACAGGTAACGGGTTTGCCTGAAACCGATGAAAACGGCAGAAC
GCGCTTTATTGGCATCGCCCAAACAGCCAATCAACAAAACTATCGCGTGCTGTTCCAAGATTATTATGCGCGAGACTGGC
GCGTGAGCGATGTGTGGCAAACGACTGCGCGTATTCGTGCGGCGGTTGCCACGCGCAATCCAGTAGGCTTTGACCGCGAA
GCGTGGGCATTGGCAAACGGCATAGACGGCATGGCATCGTTGGGCAAAGAGCGCAAAGCCGTTGCCGTATCCACCAAAAG
CAGCCTGCACTTTTTTAACCAACTTCGCGCCAACATCGTGCAAACATGGCAGCGCAACGCCAGCGCAGACTATCCGCAAG
GCGTGGGCTTGATGACGGCTTTGGCGGTGGGCAATCGCAGCGATTTGTCGCAGGCTGCTTGGGATTCGTTTCGTCCGTTG
GGACTGAATCATTTGATTAGCATTTCGGGCTTGCACATTAGCATGGTGGGCGTGTTGGCAGCGTGGTTGGCGCAGCGTTG
TATGCGACTGCTGCCTGTATTGCCAGCGCGTCCCAAAGTCATCAGCATAGTTGTGGGCTGGCTGGCGGCGGTGGTTTATA
CGGGTTTGGCAGGCTGGGAAATTCCTGCACTTCGCAGCTTAATCATGCTCACGGTGTGGGCAATCGCGTGGCTGGCGCGT
GGACATTGGGGCGTGTGGCAAACGTGGTGGGCAGCCTGCACCGCCGTGTTGCTGTATCAACCCACATCGGTGCTGGCGGT
TGGGTTTTGGCTATCGTTTGGCTTGGTGGGCGCGTTGTTGTGGGCGTTATCGTGCAGGCTGCCTAGTCGCCCCAAACCAT
ACGACACATTGCGCCAAGCATTCATCGGGCAATGGGCGGCAACGCTGGTGGGCGGCATTGCCACGATTTTTTTGTTTGGC
ATACTCGCCGTGTACAGCCCATTGGTCAATGCCGTTGCCATACCGTTTTTTTCTAGCATACTCACGCCGCTGGCATTAGT
CGCGTCCGCCCTGCCATTCGCACCACTGCAACGCCTAGCCGCTTGGTTGGGCGAACACACCATACATATCTTGCTCGCAT
TAAGCCGACATCTGCCCGAACAAGCCTTCGCACAACCGCCTAGTTTCTTGTTTTGGCTGACCATTTTTTCCACGCTGATT
ATTTTGTTACCACGCGGCACAGCACTCAAACCGCTTGCTTGCGTCATCATCGCCAGTTTTTTGCTCTACACGCCCCCTGC
CCCACGCGCACCGCTTGCCGTTCACGTTTGGGACGTAGGGCAAGGCTTGTCGGTGCTATTGCAAACGCGCCACCACAATC
TTTTGTTTGACACAGGCACACCAGCCGCTGAAATGGCATTGTTACCCAATCTACGTGCACTCGGCATACAGCAAATAGAC
ACGCTCGTCTTATCGCACCACGACAACGACCACGATGGCGGCTACGCAGCATTGCACCGCGCTATGCCAATCCGCCAAAC
ATGGGCAGGGCAGCCTGCACATTACGCCAATGCCAAGCTCTGCACACACGGCACAAATTGGCAACAAGACGGCGTGTGGT
TTGAATTTTTAACGCCCAACACGCAATCCGACAACGACAACGACCAAAGCTGCGTATTGCGAATTGTGGCTGGCGAACAG
GCGTTGCTGATAATGGGCGATGTGGGCAACGATGGCGAAACCGCCCTGCTCCGTCAATATGGCGAACAACTAGCAAGTCA
AGTATTAGTGCTGGGGCATCACGGCAGCAAATCGTCCAGCCACGCCCGTTTTTTAGACCACATTGCGCCCAGCGTTGCCA
TTGCCAGCAGCGGTTTTGCCAACCATTTTCGCCACCCACACCCCGATGTACAGCAGCGTTTAGCCAGCCGACAAATTGCA
CTTTGGCGCACTGACACGCAAGGCAGCCTGCACTTTGAACTGGGCAACCATCGCGCGATTGAATTGATTGAACAGCAAAA
AAAATGGTGGCAACGCAAGCCGTTTGCCGCGCCGCCACCCAGTTGA
ATGCCCCCAACACGCTACTTGGCTGCCTTTTGCATTGGCGCGATAAGCAGTTTTTATTTGCCCGAACAAGGCAATGTGTG
GGCGTGGTGTGTGGGTTTGCTATTGTGTGCAGGTTTGGCTTTTTGTTTACGCCGTGTCGCGTGGCAACAAAAAGCAGCCT
GCACTTTTTTGTGCCTACTTTTGGGCGCGATGTATGCCATTGGGCGCACCGAAATCGCGCTATCGCAATCGCAAGCCTAT
CCAGCACAACTGTATCCGACTTCGCAAACGATTCGCGTACAGGTAACGGGTTTGCCTGAAACCGATGAAAACGGCAGAAC
GCGCTTTATTGGCATCGCCCAAACAGCCAATCAACAAAACTATCGCGTGCTGTTCCAAGATTATTATGCGCGAGACTGGC
GCGTGAGCGATGTGTGGCAAACGACTGCGCGTATTCGTGCGGCGGTTGCCACGCGCAATCCAGTAGGCTTTGACCGCGAA
GCGTGGGCATTGGCAAACGGCATAGACGGCATGGCATCGTTGGGCAAAGAGCGCAAAGCCGTTGCCGTATCCACCAAAAG
CAGCCTGCACTTTTTTAACCAACTTCGCGCCAACATCGTGCAAACATGGCAGCGCAACGCCAGCGCAGACTATCCGCAAG
GCGTGGGCTTGATGACGGCTTTGGCGGTGGGCAATCGCAGCGATTTGTCGCAGGCTGCTTGGGATTCGTTTCGTCCGTTG
GGACTGAATCATTTGATTAGCATTTCGGGCTTGCACATTAGCATGGTGGGCGTGTTGGCAGCGTGGTTGGCGCAGCGTTG
TATGCGACTGCTGCCTGTATTGCCAGCGCGTCCCAAAGTCATCAGCATAGTTGTGGGCTGGCTGGCGGCGGTGGTTTATA
CGGGTTTGGCAGGCTGGGAAATTCCTGCACTTCGCAGCTTAATCATGCTCACGGTGTGGGCAATCGCGTGGCTGGCGCGT
GGACATTGGGGCGTGTGGCAAACGTGGTGGGCAGCCTGCACCGCCGTGTTGCTGTATCAACCCACATCGGTGCTGGCGGT
TGGGTTTTGGCTATCGTTTGGCTTGGTGGGCGCGTTGTTGTGGGCGTTATCGTGCAGGCTGCCTAGTCGCCCCAAACCAT
ACGACACATTGCGCCAAGCATTCATCGGGCAATGGGCGGCAACGCTGGTGGGCGGCATTGCCACGATTTTTTTGTTTGGC
ATACTCGCCGTGTACAGCCCATTGGTCAATGCCGTTGCCATACCGTTTTTTTCTAGCATACTCACGCCGCTGGCATTAGT
CGCGTCCGCCCTGCCATTCGCACCACTGCAACGCCTAGCCGCTTGGTTGGGCGAACACACCATACATATCTTGCTCGCAT
TAAGCCGACATCTGCCCGAACAAGCCTTCGCACAACCGCCTAGTTTCTTGTTTTGGCTGACCATTTTTTCCACGCTGATT
ATTTTGTTACCACGCGGCACAGCACTCAAACCGCTTGCTTGCGTCATCATCGCCAGTTTTTTGCTCTACACGCCCCCTGC
CCCACGCGCACCGCTTGCCGTTCACGTTTGGGACGTAGGGCAAGGCTTGTCGGTGCTATTGCAAACGCGCCACCACAATC
TTTTGTTTGACACAGGCACACCAGCCGCTGAAATGGCATTGTTACCCAATCTACGTGCACTCGGCATACAGCAAATAGAC
ACGCTCGTCTTATCGCACCACGACAACGACCACGATGGCGGCTACGCAGCATTGCACCGCGCTATGCCAATCCGCCAAAC
ATGGGCAGGGCAGCCTGCACATTACGCCAATGCCAAGCTCTGCACACACGGCACAAATTGGCAACAAGACGGCGTGTGGT
TTGAATTTTTAACGCCCAACACGCAATCCGACAACGACAACGACCAAAGCTGCGTATTGCGAATTGTGGCTGGCGAACAG
GCGTTGCTGATAATGGGCGATGTGGGCAACGATGGCGAAACCGCCCTGCTCCGTCAATATGGCGAACAACTAGCAAGTCA
AGTATTAGTGCTGGGGCATCACGGCAGCAAATCGTCCAGCCACGCCCGTTTTTTAGACCACATTGCGCCCAGCGTTGCCA
TTGCCAGCAGCGGTTTTGCCAACCATTTTCGCCACCCACACCCCGATGTACAGCAGCGTTTAGCCAGCCGACAAATTGCA
CTTTGGCGCACTGACACGCAAGGCAGCCTGCACTTTGAACTGGGCAACCATCGCGCGATTGAATTGATTGAACAGCAAAA
AAAATGGTGGCAACGCAAGCCGTTTGCCGCGCCGCCACCCAGTTGA
3D structure
| Source | ID | Structure |
|---|
Similar proteins
Only experimentally validated proteins are listed.
| Protein | Organism | Identities (%) | Coverage (%) | Ha-value |
|---|---|---|---|---|
| comA | Neisseria gonorrhoeae MS11 |
45.352 |
93.298 |
0.423 |