Genbank accession
WPA90006.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,79
TSP
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 0,999
C3 0,999
C1 0,003
C2 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIGVDCDYSNIQSNVFIDCRDYFANFTTAHDVKFDNNLCDGCSVTGAAALRFIDSNRFKSTNNTIKNLTGAGGLVYRVSNTAAGATRDWLISDNDVYRNVAGFGYIFHILGDNNTGGKIRRNNFKADGVTGWQWYILSDNLATFSTHENELESTGTGYITSGANVTAGDDTINGSRNVWSATPTAFKSRTGQIATIAKIVKSFDGTNWNSANVVAVTYDPPSIPANGGQITTTVTATGAVIGDFAQATFSVFDANIDISAIVTATNQVTVKFRNNSASAIDLASGTLRVRVT
Physico‐chemical
properties
protein length:292 AA
molecular weight: 31188,05340 Da
isoelectric point:5,56638
aromaticity:0,09932
hydropathy:-0,12466

Domains

View on InterPro
WPA90006.1
1 292 aa
STR 7–208 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

WPA90006.1
1 292 aa
Domain Start End Length (AA) Confidence
N-terminal 1 10 10 0,0029
Central domain 11 199 190 0,8640
C-terminal 200 292 92 0,9990
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
WPA90006.1 [NCBI]
Genbank nucleotide accession
OR665531.1 [NCBI]
CDS location
range 159 -> 1037
strand +
CDS
ATGATTGGCGTTGACTGTGACTACTCTAACATTCAGAGTAATGTATTTATAGATTGTCGAGACTACTTTGCTAACTTTACTACAGCGCACGATGTGAAATTTGATAACAATCTTTGTGACGGATGCTCTGTTACTGGTGCGGCCGCTTTAAGATTTATCGATAGCAATCGATTCAAGAGTACCAATAACACTATTAAAAATCTAACTGGTGCTGGTGGCCTTGTTTACAGGGTAAGTAATACGGCAGCAGGAGCAACTAGGGATTGGCTAATATCAGACAATGATGTATACAGAAACGTTGCTGGATTTGGATATATATTCCACATACTAGGAGATAATAATACTGGAGGTAAGATTAGACGGAATAACTTTAAGGCTGACGGTGTAACTGGTTGGCAGTGGTATATATTATCAGATAATCTCGCAACATTCTCCACGCATGAGAATGAGCTTGAGTCAACAGGAACAGGATATATTACTTCTGGAGCTAATGTTACTGCTGGAGATGATACAATTAACGGGTCTCGAAATGTATGGTCTGCTACTCCAACTGCCTTCAAGTCAAGAACAGGTCAAATCGCCACAATTGCTAAAATTGTAAAATCATTTGACGGCACCAACTGGAACTCTGCCAACGTTGTTGCAGTTACTTATGATCCACCTTCCATTCCTGCTAATGGTGGTCAAATTACAACTACTGTTACTGCTACTGGCGCAGTTATTGGGGATTTTGCGCAGGCCACATTTAGTGTTTTTGATGCGAATATTGATATAAGTGCTATAGTTACTGCAACAAATCAGGTTACAGTTAAGTTTAGAAACAATAGCGCTTCCGCAATAGACTTGGCAAGCGGAACATTGCGAGTAAGAGTAACTTAA

Genome Context

Tertiary structure

WPA90006.1
ESMFold structure
Source ESMFold
pLDDT 76.4
Oligomeric state monomer