Genbank accession
YP_654148.1 [GenBank]
Protein name
tail spike protein
RBP type
TSP
Evidence GenBank
Probability 1,00
TF
Evidence Phold
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,91
TSP
Evidence RBPdetect2
Probability 0,82
Seq2Symm
C3 confidence 1,000
C3 1,000
C4 0,000
D2 0,000
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MIQRLGSSLVKFKSKIAGAIWRNLDDKLTEVVSLKDFGAKGDGKTNDQDAVNAAMASGKRIDGAGATYKVSSLPDMERFYNTRFVWERLAGQPLYYVSKGFINGELYKITDNPYYNAWPQDKAFVYENVIYAPYMGSDRHGVSRLHVSWVKSGDDGQTWSTPEWLTDLHPDYPTVNYHCMSMGVCRNRLFAMIETRTLAKNKLTNCALWDRPMSRSLHLTGGITKAANQQYATIHVPDHGLFVGDFVNFSNSAVTGVSGDMTVATVIDKDNFTVLTPNQQTSDLNNAGKSWHMGTSFHKSPWRKTDLGLIPSVTEVHSFATIDNNGFVMGYHQGDVAPREVGLFYFPDAFNSPSNYVRRQIPSEYEPDASEPCIKYYDGVLYLITRGTLGDRLGSSLHRSRDIGQTWESLRFPHNVHHTTLPFAKVGDDLIMFGSERAENEWEAGAPDDRYKASYPRTFYARLNVNNWNADDIEWVNITDQIYQGDIVNSSVGVGSVVVKDSYIYYIFGGENHFNPMTYGDNKGKDPFKGHGHPTDIYCYKMQIANDNRVSRKFTYGATPGQAIPTFMGTDGIRNIPAPLYFSDNIVTEDTKVGHLTLKASTSSNIRSEVQMEGEYGFIGKSVPKDNPTGQRLIICGGEETSSSSGAQITLHGSNSSKANRITYNGNEHLFQGAPIMPAVDNQFAAGGPSNRFTTIYLGSDPVTTSDADHKYSISSINTKVLKAWSRVGFKQYGLNSEAERDLDSIHFGVLAQDIVAAFEAEGLDAIKYGIVSFEEGRYGVRYSEVLILEAAYTRYRLDKLEEMYATNKIS
Physico‐chemical
properties
protein length:811 AA
molecular weight: 90382,89800 Da
isoelectric point:6,04388
aromaticity:0,11344
hydropathy:-0,44957

Domains

View on InterPro
YP_654148.1
1 811 aa
ATT 34–102 · STR 103–705 · RBD 706–777 · CHP 778–808 ·

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

YP_654148.1
1 811 aa
Domain Start End Length (AA) Confidence
N-terminal 1 48 48 0,9553
Central domain 49 279 232 0,7767
C-terminal 280 811 531 0,5776
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Host No host information

Coding sequence (CDS)

Genbank protein accession
YP_654148.1 [NCBI]
Genbank nucleotide accession
NC_008152.1 [NCBI]
CDS location
range 41351 -> 43786
strand +
CDS
ATGATTCAAAGACTAGGTTCTTCATTAGTTAAATTCAAGAGTAAAATAGCAGGTGCAATCTGGCGTAACTTGGATGACAAGCTCACCGAGGTTGTATCGCTTAAAGATTTTGGAGCCAAAGGTGATGGTAAGACAAACGACCAAGATGCAGTAAATGCAGCGATGGCTTCAGGTAAGAGAATTGACGGTGCTGGTGCTACTTACAAAGTATCATCTTTACCTGATATGGAGCGATTCTATAACACCCGCTTCGTATGGGAACGTTTAGCAGGTCAACCTCTTTACTATGTGAGTAAAGGTTTTATCAATGGTGAACTATATAAAATCACGGATAACCCTTATTACAATGCTTGGCCTCAAGACAAAGCGTTTGTATATGAGAACGTGATATATGCACCTTACATGGGTAGTGACCGTCATGGTGTTAGTCGTCTGCATGTATCATGGGTTAAGTCTGGTGACGATGGTCAAACATGGTCTACTCCAGAGTGGTTAACTGATCTGCATCCAGATTACCCTACAGTGAACTATCATTGTATGAGTATGGGTGTATGTCGCAACCGTCTGTTTGCCATGATTGAAACACGTACTTTAGCCAAGAACAAACTAACCAATTGTGCATTGTGGGATCGCCCTATGTCTCGTAGTCTGCATCTTACTGGTGGTATCACTAAGGCTGCAAATCAGCAATATGCAACAATACATGTACCAGATCACGGACTATTCGTGGGCGATTTTGTTAACTTCTCTAATTCTGCGGTAACAGGTGTATCAGGTGATATGACTGTTGCAACGGTAATAGATAAGGACAACTTCACGGTTCTTACACCTAACCAGCAGACTTCAGATTTGAATAACGCTGGAAAGAGTTGGCACATGGGTACTTCTTTCCATAAGTCTCCATGGCGTAAGACAGATCTTGGTCTAATCCCTAGTGTCACAGAGGTGCATAGCTTTGCTACTATTGATAACAATGGCTTTGTTATGGGCTATCATCAAGGTGATGTAGCTCCACGAGAAGTTGGTCTTTTCTACTTCCCTGATGCTTTCAATAGCCCATCTAATTATGTTCGTCGTCAGATACCATCTGAGTATGAACCAGATGCGTCAGAGCCATGCATCAAGTACTATGACGGTGTATTATACCTTATCACTCGTGGCACTCTTGGTGACAGACTTGGAAGCTCTTTGCATCGTAGTAGAGATATAGGTCAGACTTGGGAGTCACTGAGATTTCCACATAATGTTCATCATACTACCCTACCTTTTGCTAAAGTAGGAGATGACCTTATTATGTTTGGTTCAGAACGTGCAGAAAATGAATGGGAAGCAGGTGCACCAGATGATCGTTACAAGGCATCTTATCCTCGTACCTTCTATGCACGATTGAATGTAAACAATTGGAATGCAGATGATATTGAATGGGTTAACATCACAGACCAAATCTATCAAGGTGACATTGTGAACTCTAGTGTAGGTGTAGGTTCGGTAGTAGTTAAAGACAGCTACATTTACTATATCTTTGGTGGCGAAAACCATTTCAACCCAATGACTTATGGTGACAACAAAGGTAAAGACCCATTTAAAGGTCATGGACACCCTACTGATATATACTGCTATAAGATGCAGATTGCAAATGACAATCGTGTATCTCGTAAGTTTACATATGGTGCAACTCCGGGTCAAGCTATACCTACTTTCATGGGTACTGATGGAATACGAAATATCCCTGCACCTTTGTATTTCTCAGATAACATTGTTACAGAGGATACTAAAGTTGGACACTTAACACTTAAAGCAAGCACAAGTTCCAATATACGATCTGAAGTGCAGATGGAAGGTGAATATGGCTTTATTGGCAAGTCTGTTCCAAAGGACAACCCAACTGGTCAACGTTTGATTATTTGTGGTGGAGAAGAGACTTCGTCCTCTTCAGGTGCACAGATAACTTTGCACGGCTCTAATTCAAGTAAGGCTAATCGTATCACTTATAACGGAAATGAGCACCTATTCCAAGGTGCACCAATCATGCCTGCTGTAGATAACCAGTTTGCTGCTGGTGGACCTAGTAACCGATTCACTACCATCTACCTAGGTAGTGACCCTGTTACAACTTCAGATGCTGACCACAAGTACAGTATCTCTAGTATTAATACCAAGGTGTTAAAGGCTTGGAGCAGGGTTGGTTTTAAACAGTATGGTTTGAATAGTGAAGCAGAGAGGGACCTTGATAGCATACACTTCGGTGTCTTGGCTCAGGATATTGTAGCTGCTTTTGAAGCTGAAGGGTTGGATGCCATTAAGTATGGAATTGTGTCCTTCGAAGAAGGTAGGTACGGTGTGAGGTATAGTGAAGTTCTAATACTAGAGGCTGCTTATACTCGTTATCGTTTAGACAAGTTAGAGGAGATGTATGCCACTAATAAAATCAGTTAA

Genome Context

Tertiary structure

YP_654148.1
ESMFold structure
Source ESMFold
pLDDT 66.8
Oligomeric state monomer