Genbank accession
YP_008130362.1 [GenBank]
Protein name
tail spike protein
RBP type
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,99
Seq2Symm
C3 confidence 1,000
C3 1,000
C1 0,013
C5 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MSSGCGDVLSLEDLKTAKKHQLFEAEVITGRSGGVATGAFIDIATNQATGQVQKTMPAVLRDIGFAPASFDFNTGGTISDRNVAVLWPLPGGDGDWYVWEGALPKIIPAASTPDSTGGVAAGAWKAVNSNALRDQLSVVSPEMFGAIGNGIADDTIAWQAMDSYVSARATASHIITIIASRKYRVTAQLNGWSYVNLLGGGTLIYDGADQLNSTVLTYNSKTKFNISNINITRNFNDPFALRSKGAYGLTLASCSDFSVVGCDIYMHTDALSVMDSDRFKIESNRTHELGEEGIAVRRSRNWSVINNDVYHHNGDGILIKTGNVSSYAGSICDNRVYDGIQSAGTAGGNRGGGITGNDEVIGGGATESFNRLIVERNHCYNVSYGIAFTNIVDLSMSNNMVNNIDRFGIIIDTALFNNPNKNPVKRISVSNNHVSGTVQAGLLFTGTADISVSQVTISNNIVDTCGTSTAAGYPAIGASFASVTGNKVTNCKIGLQVEGCATTGNVITDSTYTSSAPASVWVKIIGGGSFNGNSLSDSKFGHIRFSSISGLTFTGNTITTASSFACLYFDSVSSGSTCIFRANNYVSAFTNVSVFNIGAVPAVPALVGDELIVSSPPAGGIRRLVCVTAGNPGVYVPVEWNIISAVSSSSSPTINAGASLRITGTAAGVASNSACVGAKFNQDPQGVDMVASVTGAGTVTFILTNNTGSSKTFSNLVMTAYCHS
Physico‐chemical
properties
protein length:724 AA
molecular weight: 75413,41280 Da
isoelectric point:5,82880
aromaticity:0,07873
hydropathy:0,07403

Domains

View on InterPro
YP_008130362.1
1 724 aa
ATT 65–138 · STR 139–563 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_008130362.1
1 724 aa
Domain Start End Length (AA) Confidence
N-terminal 1 154 154 0,9885
Central domain 155 589 436 0,9944
C-terminal 590 724 134 0,9840
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
YP_008130362.1 [NCBI]
Genbank nucleotide accession
NC_021563 [NCBI]
CDS location
range 40550 -> 42724
strand +
CDS
ATGTCTAGCGGCTGCGGTGACGTCTTGTCACTTGAAGACCTGAAAACAGCGAAAAAACATCAACTTTTCGAAGCAGAGGTTATTACCGGCCGTTCCGGCGGAGTGGCCACTGGGGCATTTATCGATATTGCGACGAACCAAGCAACGGGCCAAGTTCAAAAAACTATGCCCGCAGTACTGCGCGACATTGGCTTTGCGCCAGCATCGTTCGATTTTAATACCGGTGGGACTATTTCAGATCGTAATGTTGCCGTGTTATGGCCTCTCCCTGGTGGAGATGGAGATTGGTATGTGTGGGAAGGTGCATTACCTAAAATTATTCCTGCTGCGTCCACACCTGATTCCACCGGCGGGGTAGCAGCCGGGGCGTGGAAAGCCGTAAATAGTAATGCGTTACGTGACCAGTTATCTGTAGTGTCCCCGGAAATGTTTGGCGCAATAGGTAACGGGATCGCAGATGATACTATTGCTTGGCAAGCGATGGATAGCTATGTGTCAGCCAGAGCCACTGCAAGCCATATTATTACGATTATTGCATCGAGGAAATATAGGGTAACCGCGCAACTTAATGGGTGGAGTTACGTTAACTTATTAGGCGGCGGAACTCTAATCTATGACGGCGCTGACCAGTTAAACTCAACGGTACTTACGTATAATAGTAAGACTAAATTCAATATTTCTAATATAAATATTACTAGAAATTTCAATGACCCTTTCGCTCTGCGGTCTAAAGGGGCGTATGGATTAACACTAGCATCCTGCTCTGATTTCTCGGTGGTAGGGTGCGATATCTATATGCACACAGACGCGCTGTCTGTTATGGATTCTGATAGATTTAAAATTGAATCTAACCGTACACATGAATTAGGTGAAGAGGGTATTGCAGTGCGCCGCTCTCGCAACTGGAGCGTAATTAACAATGATGTGTACCACCATAACGGTGATGGGATATTAATAAAAACTGGCAACGTTTCAAGTTACGCCGGCAGCATTTGCGATAACCGAGTGTACGACGGTATCCAGTCCGCTGGCACTGCCGGGGGTAACCGCGGCGGGGGCATTACGGGTAATGACGAGGTAATCGGCGGAGGCGCCACTGAGTCTTTTAATCGTCTAATTGTAGAAAGAAACCATTGCTATAATGTTAGCTACGGCATCGCCTTTACTAATATTGTCGACCTGTCAATGTCTAACAACATGGTTAATAACATCGACCGTTTTGGCATTATTATCGACACTGCGCTTTTTAATAACCCTAACAAGAATCCGGTAAAACGTATCAGTGTTAGTAACAACCATGTGTCAGGTACAGTGCAGGCCGGGCTATTATTTACCGGGACTGCGGATATATCGGTTAGTCAAGTAACGATATCAAACAACATAGTTGATACTTGCGGCACCTCCACCGCCGCTGGGTACCCAGCTATCGGAGCATCTTTTGCATCTGTAACCGGTAACAAGGTTACCAATTGCAAGATTGGTCTACAGGTGGAAGGGTGCGCTACTACCGGTAACGTTATTACGGATTCAACTTATACTAGCTCCGCGCCAGCGTCGGTGTGGGTTAAGATAATCGGCGGCGGCAGCTTCAATGGGAACAGTTTATCCGATTCAAAATTCGGACACATCAGATTCTCCAGTATAAGCGGTTTAACATTTACCGGGAACACGATCACAACGGCGAGTAGTTTCGCCTGCTTATATTTTGACTCTGTTTCCTCCGGTAGCACCTGTATTTTTAGAGCTAACAATTATGTGAGCGCATTCACTAATGTGTCAGTTTTTAACATTGGCGCCGTGCCCGCCGTACCCGCGTTAGTAGGCGATGAGCTAATCGTGTCCTCTCCGCCTGCGGGCGGCATTCGCCGGTTGGTGTGCGTAACTGCCGGCAATCCAGGCGTTTACGTCCCTGTTGAGTGGAATATAATTTCTGCGGTTTCGTCATCCAGCAGCCCAACCATAAATGCTGGTGCATCATTACGTATAACCGGAACAGCCGCTGGGGTGGCGAGCAATTCAGCCTGTGTTGGGGCTAAATTTAACCAAGACCCGCAAGGGGTTGATATGGTAGCGTCGGTTACTGGCGCCGGGACAGTCACGTTCATCCTGACCAACAACACCGGATCAAGCAAAACATTTAGTAATTTGGTAATGACGGCGTATTGCCATTCATAA

Genome Context

Tertiary structure

YP_008130362.1
ESMFold structure
Source ESMFold
pLDDT 81.6
Oligomeric state monomer