Protein
- Genbank accession
- QGJ94881.1 [GenBank]
- Protein name
- glycosylhydrolase
- RBP type
-
TSPTSP
- Seq2Symm
-
C1 confidence 0,948
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).C1 0,948 C2 0,110 C3 0,001 - Protein sequence
-
MARVTITDYVFEPSTRRVTLNGVGTVSIPQILSIRNQTTGQLYYLKSDYRTLRLEGNTLILPSGTVGLAASASDRLEIAYETSVPSDPGSGGGLSQTEVETIAQNAAAAAVATAAPLVDSRVPAANLPPLFRTTDAQPFAADSIWNTPIGDGCAFEASSAPATASFLAATPAINDGTTYGFTNNVARPTDPICTATMISNGKVFTFRCPYDPVISPGTDLSMRVIDGWQAIDLWKTTKTGLYTFTAEFITVTDLRGTGRNTGTRAARFPSAGGLIRAHELGKCYIPHALCISIPASSLKLGFVWPAAAEDSQTNLTYSGQVPMGSFFAIPASVDLSTLGLSPEGLALAECLQKYGMYVGDQSGSAAISVDGEATVAMPSALERLRTDWTTKLFGQLRRVTNVGTVAGGPGARRAPAAGPVAVRSDPQDVTFDILVSRLRATNGIMLTSHDGGTDVSPVVSTNASLGGKSLSWMNWPAQYQTLDGAIRRIASPDGATRILTVNPGVRDVRVGVTVVSMHSSGFAYLVAAGTGSTDGFRLAVTSGGSCHLQKIVSGGSGAIQISPSLPNGSVAAGKRVELMIYGPYVAAIIDGEVALEASDTQNITGTQTGIYFPSDTNIAWRRFTVHSVPRVFRKPTAA
- Physico‐chemical
properties -
protein length: 638 AA molecular weight: 66760,68700 Da isoelectric point: 7,00401 aromaticity: 0,07210 hydropathy: 0,04890
Tail Spike Domain Segmentation
Segmented into three structural domains: N-terminal, central, and C-terminal.
Domain layout
QGJ94881.1
1
638 aa
| Domain | Start | End | Length (AA) | Confidence |
|---|---|---|---|---|
| N-terminal | 1 | 118 | 118 | 0,8819 |
| Central domain | 119 | 336 | 219 | 0,5597 |
| C-terminal | 337 | 638 | 301 | 0,7238 |
N-terminal
Central domain
C-terminal
View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.
Taxonomy
Coding sequence (CDS)
Genbank protein accession
QGJ94881.1
[NCBI]
Genbank nucleotide accession
MN586040
[NCBI]
CDS location
range 21743 -> 23659
strand +
strand +
CDS
ATGGCCAGAGTCACCATCACCGATTACGTGTTCGAGCCATCGACTCGGCGAGTCACGCTCAACGGCGTTGGCACCGTCTCGATCCCGCAGATTCTCTCGATCCGCAACCAGACCACCGGCCAGCTCTACTACCTGAAGAGCGACTACCGGACGCTGCGGCTGGAGGGCAACACGCTGATCCTGCCGTCGGGCACCGTCGGCCTGGCTGCGAGCGCCAGCGACCGGCTGGAGATCGCCTACGAGACCTCCGTGCCGTCGGACCCCGGCAGTGGTGGAGGTCTGTCGCAGACCGAGGTCGAGACCATCGCACAGAACGCCGCTGCGGCGGCGGTGGCGACTGCTGCTCCCCTGGTCGACTCCCGCGTGCCTGCGGCCAACCTGCCGCCGCTGTTCCGCACCACCGATGCGCAGCCGTTCGCTGCGGACTCGATCTGGAACACCCCGATCGGCGACGGGTGTGCCTTCGAGGCGTCCTCGGCCCCGGCCACCGCGAGTTTCCTGGCCGCGACTCCGGCAATCAACGACGGCACGACCTACGGCTTCACCAACAACGTGGCCCGGCCCACCGATCCGATCTGCACCGCGACGATGATCAGCAACGGCAAGGTGTTCACCTTCCGGTGCCCCTACGACCCGGTCATCTCGCCGGGCACCGACTTGTCGATGCGCGTCATCGACGGGTGGCAGGCGATCGATCTCTGGAAGACCACCAAGACCGGCCTCTACACGTTCACCGCCGAGTTCATCACCGTGACCGACCTGCGGGGCACCGGACGCAACACCGGTACCCGTGCGGCGCGGTTCCCGTCGGCAGGCGGGCTCATCCGCGCTCACGAGTTGGGCAAGTGCTACATCCCGCACGCGTTGTGCATCTCGATCCCGGCCAGCTCCCTGAAGCTGGGCTTCGTGTGGCCTGCGGCGGCAGAGGACTCACAGACCAACCTCACCTACTCCGGCCAGGTGCCGATGGGGTCGTTCTTCGCGATCCCGGCCAGCGTCGACCTCTCCACGCTCGGCCTGTCTCCGGAAGGGCTCGCGCTCGCCGAGTGCCTGCAGAAGTACGGCATGTACGTCGGCGACCAGTCCGGTTCGGCGGCGATTTCGGTCGACGGCGAGGCCACGGTTGCCATGCCCAGCGCACTGGAGCGCCTGCGCACCGACTGGACAACCAAGCTGTTCGGCCAGCTGCGTCGCGTCACCAACGTTGGCACTGTCGCGGGTGGCCCCGGAGCCCGGCGCGCTCCGGCGGCTGGTCCGGTCGCGGTGCGCTCCGATCCGCAGGACGTCACCTTCGACATTCTGGTGAGTCGGCTGCGCGCGACCAACGGCATCATGCTGACGTCGCACGACGGCGGAACCGACGTCTCTCCGGTCGTGTCGACCAACGCAAGCCTGGGCGGCAAGTCTCTGTCGTGGATGAACTGGCCTGCGCAGTACCAGACTCTCGACGGAGCGATTCGCCGCATCGCCTCTCCGGACGGCGCGACCCGCATCCTGACGGTCAATCCCGGAGTGCGAGACGTTCGCGTCGGCGTGACCGTGGTCTCGATGCACAGCAGCGGCTTCGCCTACCTGGTGGCCGCTGGGACCGGCTCCACCGACGGATTCCGGCTGGCGGTGACATCAGGAGGTTCCTGCCACCTCCAGAAGATCGTCTCCGGCGGCAGCGGCGCGATCCAGATTTCGCCGTCCCTGCCCAATGGCTCGGTGGCGGCGGGCAAGCGCGTCGAGCTGATGATCTACGGTCCCTACGTCGCGGCGATCATCGACGGCGAGGTGGCCCTGGAGGCCAGCGACACTCAGAACATCACCGGGACCCAGACCGGCATCTACTTCCCCTCCGACACCAACATCGCCTGGCGCAGGTTCACCGTGCATTCGGTGCCTCGGGTGTTCCGCAAGCCGACGGCTGCGTAG