Genbank accession
QGJ94881.1 [GenBank]
Protein name
glycosylhydrolase
RBP type
TSP
Evidence DepoScope
Probability 0,77
TSP
Evidence RBPdetect2
Probability 0,36
Seq2Symm
C1 confidence 0,948
C1 0,948
C2 0,110
C3 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MARVTITDYVFEPSTRRVTLNGVGTVSIPQILSIRNQTTGQLYYLKSDYRTLRLEGNTLILPSGTVGLAASASDRLEIAYETSVPSDPGSGGGLSQTEVETIAQNAAAAAVATAAPLVDSRVPAANLPPLFRTTDAQPFAADSIWNTPIGDGCAFEASSAPATASFLAATPAINDGTTYGFTNNVARPTDPICTATMISNGKVFTFRCPYDPVISPGTDLSMRVIDGWQAIDLWKTTKTGLYTFTAEFITVTDLRGTGRNTGTRAARFPSAGGLIRAHELGKCYIPHALCISIPASSLKLGFVWPAAAEDSQTNLTYSGQVPMGSFFAIPASVDLSTLGLSPEGLALAECLQKYGMYVGDQSGSAAISVDGEATVAMPSALERLRTDWTTKLFGQLRRVTNVGTVAGGPGARRAPAAGPVAVRSDPQDVTFDILVSRLRATNGIMLTSHDGGTDVSPVVSTNASLGGKSLSWMNWPAQYQTLDGAIRRIASPDGATRILTVNPGVRDVRVGVTVVSMHSSGFAYLVAAGTGSTDGFRLAVTSGGSCHLQKIVSGGSGAIQISPSLPNGSVAAGKRVELMIYGPYVAAIIDGEVALEASDTQNITGTQTGIYFPSDTNIAWRRFTVHSVPRVFRKPTAA
Physico‐chemical
properties
protein length:638 AA
molecular weight: 66760,68700 Da
isoelectric point:7,00401
aromaticity:0,07210
hydropathy:0,04890

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

QGJ94881.1
1 638 aa
Domain Start End Length (AA) Confidence
N-terminal 1 118 118 0,8819
Central domain 119 336 219 0,5597
C-terminal 337 638 301 0,7238
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
QGJ94881.1 [NCBI]
Genbank nucleotide accession
MN586040 [NCBI]
CDS location
range 21743 -> 23659
strand +
CDS
ATGGCCAGAGTCACCATCACCGATTACGTGTTCGAGCCATCGACTCGGCGAGTCACGCTCAACGGCGTTGGCACCGTCTCGATCCCGCAGATTCTCTCGATCCGCAACCAGACCACCGGCCAGCTCTACTACCTGAAGAGCGACTACCGGACGCTGCGGCTGGAGGGCAACACGCTGATCCTGCCGTCGGGCACCGTCGGCCTGGCTGCGAGCGCCAGCGACCGGCTGGAGATCGCCTACGAGACCTCCGTGCCGTCGGACCCCGGCAGTGGTGGAGGTCTGTCGCAGACCGAGGTCGAGACCATCGCACAGAACGCCGCTGCGGCGGCGGTGGCGACTGCTGCTCCCCTGGTCGACTCCCGCGTGCCTGCGGCCAACCTGCCGCCGCTGTTCCGCACCACCGATGCGCAGCCGTTCGCTGCGGACTCGATCTGGAACACCCCGATCGGCGACGGGTGTGCCTTCGAGGCGTCCTCGGCCCCGGCCACCGCGAGTTTCCTGGCCGCGACTCCGGCAATCAACGACGGCACGACCTACGGCTTCACCAACAACGTGGCCCGGCCCACCGATCCGATCTGCACCGCGACGATGATCAGCAACGGCAAGGTGTTCACCTTCCGGTGCCCCTACGACCCGGTCATCTCGCCGGGCACCGACTTGTCGATGCGCGTCATCGACGGGTGGCAGGCGATCGATCTCTGGAAGACCACCAAGACCGGCCTCTACACGTTCACCGCCGAGTTCATCACCGTGACCGACCTGCGGGGCACCGGACGCAACACCGGTACCCGTGCGGCGCGGTTCCCGTCGGCAGGCGGGCTCATCCGCGCTCACGAGTTGGGCAAGTGCTACATCCCGCACGCGTTGTGCATCTCGATCCCGGCCAGCTCCCTGAAGCTGGGCTTCGTGTGGCCTGCGGCGGCAGAGGACTCACAGACCAACCTCACCTACTCCGGCCAGGTGCCGATGGGGTCGTTCTTCGCGATCCCGGCCAGCGTCGACCTCTCCACGCTCGGCCTGTCTCCGGAAGGGCTCGCGCTCGCCGAGTGCCTGCAGAAGTACGGCATGTACGTCGGCGACCAGTCCGGTTCGGCGGCGATTTCGGTCGACGGCGAGGCCACGGTTGCCATGCCCAGCGCACTGGAGCGCCTGCGCACCGACTGGACAACCAAGCTGTTCGGCCAGCTGCGTCGCGTCACCAACGTTGGCACTGTCGCGGGTGGCCCCGGAGCCCGGCGCGCTCCGGCGGCTGGTCCGGTCGCGGTGCGCTCCGATCCGCAGGACGTCACCTTCGACATTCTGGTGAGTCGGCTGCGCGCGACCAACGGCATCATGCTGACGTCGCACGACGGCGGAACCGACGTCTCTCCGGTCGTGTCGACCAACGCAAGCCTGGGCGGCAAGTCTCTGTCGTGGATGAACTGGCCTGCGCAGTACCAGACTCTCGACGGAGCGATTCGCCGCATCGCCTCTCCGGACGGCGCGACCCGCATCCTGACGGTCAATCCCGGAGTGCGAGACGTTCGCGTCGGCGTGACCGTGGTCTCGATGCACAGCAGCGGCTTCGCCTACCTGGTGGCCGCTGGGACCGGCTCCACCGACGGATTCCGGCTGGCGGTGACATCAGGAGGTTCCTGCCACCTCCAGAAGATCGTCTCCGGCGGCAGCGGCGCGATCCAGATTTCGCCGTCCCTGCCCAATGGCTCGGTGGCGGCGGGCAAGCGCGTCGAGCTGATGATCTACGGTCCCTACGTCGCGGCGATCATCGACGGCGAGGTGGCCCTGGAGGCCAGCGACACTCAGAACATCACCGGGACCCAGACCGGCATCTACTTCCCCTCCGACACCAACATCGCCTGGCGCAGGTTCACCGTGCATTCGGTGCCTCGGGTGTTCCGCAAGCCGACGGCTGCGTAG

Genome Context

Tertiary structure

QGJ94881.1
ESMFold structure
Source ESMFold
pLDDT 70.2
Oligomeric state monomer