Genbank accession
XQQ52602.1 [GenBank]
Protein name
tail spike protein
RBP type
TF
Evidence GenBank
Probability 1,00
TSP
Evidence DepoScope
Probability 1,00
TSP
Evidence RBPdetect
Probability 0,88
TF
Evidence RBPdetect2
Probability 0,38
Seq2Symm
C3 confidence 0,999 truncated
C3 0,999
C4 0,002
C1 0,001
Predicted homo-oligomer symmetry (Seq2Symm, per-class probabilities; C1 = monomer, C2 = dimer, C3 = trimer).
Protein sequence
MNAHTPFDANQDWTNPYCHNSSNDQMVDALLGNAYHVVRTVYCNLGNLKLLYDFLNQYGMVIGVNSEEELKALSTQVKYSRIYGFSRAGDRQVTDYLYVEGDRTGIIPDDSEATGSWITVATSGSNGGGTSSSEGAYIPWVYSNGSATGGETTINVPDGTVGVPFIIVNGDMQYVGRGFEFNVDSLSVTLAQPLEEGDEVVFLLTGVPAVPDNPNINDWIQINWLYNNGAAVGGEQVIAIPYTFQSIPAVYKNGLRLYKGLTTESYTADPDNQRIFLTEPLTTNDRLIVQIGGEARVLEATDRTLQEVARAANVKDSEVILSTNTVQSLNNKKVIYNPDNQQIYVIPELPTNAYISSVVGNILTYTPGNIQVELLTKKETDQNTLWRNQGDVRGWGVKGDAVHDDTVALTNVLNDTPVGQKINGNGKTYKVTSLPDISRFVNTRFVYERIPGQPLYYASEEFVQGELFKITDTPYYNAWPQDKAFVYDDVIYCPFMASDRHGVSRLHVSWVRSGDDGQTWTTPEWLTDLHPDYPTVNYHCMSMGVMRNRLFAMIETRTLASNALVTCEIWDRPMSRNYHPTGGITKAANQPVAVITIPDHGLFAGDFVNFSNSGVTGVSGNMTVTSVIDRNTFTVTTPNQQESDQNNSTKVWHMGTSFHQSPWRKTNLGLIPMVTEVHSFTAINNDSFMMGYHQGDAAPREVGMLYFPDAFNNPGHYIKRRIPAEYEPDAAEPCVKYFDGVLYVVTRGTRSDRLGSSLHRSNDLGISWQSLRFPNNVHHSTLPFAKVGNELILFGTERADNEWEANAPDQRYFSSYPRTFYTRVNLDTWNLDNTQWVNITDQIYQGGIVNSGVGVGSVVVKDSYIYYMFGGEDHLNPWTYGDNSSKDPFKSDGHPSDLYCYKMKIGSDNRVSRDFRYGAVPDRAVPVFFDTNGIRTVPAPMEFTGDLGLGHVTLRASTSSNIRSEVLMEGEYGFIGKSVPTNNPAGQRIIFCGGDGTSSSTGAQITLYGASNTASRRIVYNGNEHLFQGADVKPYNDNVIALGGPRNRFTTAYLGSNPIVTSNGEKKTEPVVFDDAFLDAWGDVHYIMYQWLDAVQLKGNDARIHFGVIAQQIRDVFIAHGLMDENSTNCRYAVLCYDKYPRMTDTVFSHNEIVEHTDEEGNVTTTEEPVYTEVVIHEEGEEWGVRPDGIFFAEAAYQRRKLERIEARLSALEQK
Physico‐chemical
properties
protein length:1215 AA
molecular weight: 135421,99720 Da
isoelectric point:4,98259
aromaticity:0,10782
hydropathy:-0,39572

Domains

View on InterPro
XQQ52602.1
1 1215 aa
ATT 296–380 · ATT 392–463 · STR 464–1061 · CHP 1062–1074 · RBD 1075–1126 · CHP 1127–1185 · RBD 1186–1215

ATT Attachment Domain STR Structural Domain RBD Receptor-Binding Domain CBM Carbohydrate-Binding Module LEC Lectin-like Domain ENZ Enzymatic Domain CHP Intramolecular Chaperone LNK Linker/Spacer Domain TAS Tail-Associated Structural TTP Tail Tubular Protein UNK Uncharacterized Domain Unmapped

Tail Spike Domain Segmentation

Segmented into three structural domains: N-terminal, central, and C-terminal.

XQQ52602.1
1 1215 aa
Domain Start End Length (AA) Confidence
N-terminal 1 406 406 0,9963
Central domain 407 728 323 0,8890
C-terminal 729 1215 486 0,5771
N-terminal Central domain C-terminal

View these domains on the 3D structure via the Color by → Tail spike option in the Tertiary structure section below.

Taxonomy

Coding sequence (CDS)

Genbank protein accession
XQQ52602.1 [NCBI]
Genbank nucleotide accession
PV053165.1 [NCBI]
CDS location
range 5901 -> 9548
strand +
CDS
ATGAACGCACATACCCCCTTTGATGCAAATCAGGATTGGACCAATCCATATTGTCATAACAGTTCCAATGACCAAATGGTGGATGCACTGCTTGGTAATGCTTACCATGTGGTTCGTACTGTGTACTGCAACCTGGGTAATCTTAAACTCCTGTATGATTTCCTGAACCAGTATGGGATGGTCATCGGTGTAAACTCTGAAGAGGAATTGAAGGCATTATCCACGCAGGTTAAATATTCCCGTATCTACGGTTTCTCCCGTGCAGGTGACCGGCAGGTAACTGATTACTTGTACGTAGAAGGTGATCGTACTGGCATCATCCCAGATGACTCAGAAGCAACTGGTTCGTGGATTACTGTTGCTACTTCTGGTTCCAATGGTGGTGGTACTTCTTCCAGTGAAGGTGCTTATATTCCTTGGGTATACAGCAATGGTTCTGCTACTGGTGGGGAAACCACAATCAACGTACCAGATGGTACGGTGGGTGTACCTTTCATTATTGTTAATGGCGACATGCAGTATGTAGGTCGTGGATTTGAGTTCAACGTAGACAGCCTGTCCGTAACTCTGGCCCAACCTTTAGAGGAAGGAGATGAAGTAGTATTCCTTCTGACTGGTGTTCCTGCTGTACCGGATAATCCTAACATTAATGACTGGATTCAGATCAATTGGTTGTACAACAATGGTGCTGCTGTAGGGGGTGAGCAGGTTATTGCTATTCCGTATACCTTCCAGTCTATTCCGGCTGTGTATAAGAATGGTCTTCGTTTGTATAAAGGATTAACTACTGAGTCTTATACTGCTGACCCAGATAACCAACGTATTTTTCTTACCGAACCACTGACAACCAATGATCGTTTGATAGTACAGATTGGTGGTGAAGCACGAGTATTGGAAGCAACAGATCGTACTCTACAGGAAGTGGCTCGTGCGGCTAATGTAAAAGATTCTGAGGTTATTCTCAGTACTAATACAGTACAATCCTTAAATAACAAAAAAGTTATTTATAATCCCGATAATCAGCAGATTTACGTTATTCCAGAATTACCAACTAATGCGTATATATCCAGCGTAGTTGGTAATATCCTTACATATACTCCAGGTAACATTCAGGTTGAGTTACTAACCAAAAAAGAAACTGACCAAAATACCCTATGGCGTAATCAGGGAGATGTCCGTGGTTGGGGTGTTAAAGGGGACGCTGTGCATGATGATACAGTAGCATTAACGAACGTATTAAACGACACACCAGTTGGACAAAAGATTAATGGCAATGGGAAGACATATAAGGTCACATCCTTGCCTGATATTAGTCGATTCGTCAACACTCGTTTTGTTTATGAGCGTATTCCTGGTCAGCCGCTTTATTATGCCTCTGAAGAATTTGTTCAGGGCGAGCTTTTCAAAATAACGGACACCCCTTATTACAATGCGTGGCCACAGGATAAAGCGTTCGTTTACGATGATGTTATTTACTGCCCGTTCATGGCTAGTGATAGACATGGGGTCAGCAGGCTGCATGTATCCTGGGTTCGTTCAGGGGATGACGGACAGACCTGGACAACGCCGGAATGGTTAACCGACCTACATCCTGATTACCCGACAGTTAACTACCACTGTATGAGTATGGGGGTGATGCGTAATCGTCTCTTTGCGATGATTGAGACACGTACTTTAGCATCTAACGCACTGGTGACCTGTGAGATATGGGACCGTCCTATGTCCCGTAATTACCATCCGACAGGTGGTATCACAAAAGCCGCTAATCAGCCTGTGGCTGTAATTACTATTCCTGACCATGGATTGTTTGCCGGAGATTTTGTTAACTTCTCGAACTCTGGGGTGACTGGTGTTTCGGGGAATATGACTGTAACTTCAGTTATTGACCGCAACACATTTACTGTCACCACGCCAAATCAACAGGAATCTGACCAAAATAACTCTACCAAAGTCTGGCATATGGGGACATCGTTCCACCAGTCACCTTGGCGTAAAACCAACCTTGGACTGATTCCCATGGTTACCGAGGTTCACAGTTTTACCGCCATCAATAATGATTCATTTATGATGGGATATCACCAGGGTGATGCTGCTCCACGTGAAGTTGGTATGCTGTATTTCCCGGATGCATTTAACAATCCTGGGCATTATATAAAACGACGTATCCCTGCTGAATATGAGCCAGATGCGGCAGAACCCTGTGTTAAATATTTTGACGGTGTTCTTTATGTTGTAACCCGTGGAACTCGGTCGGATCGTCTGGGTAGTTCACTACATCGTAGTAACGATTTGGGTATATCCTGGCAATCATTGAGGTTCCCGAATAATGTCCACCACTCCACCCTGCCATTCGCTAAGGTAGGAAACGAACTCATTCTTTTTGGAACAGAACGTGCGGACAACGAGTGGGAAGCAAACGCACCCGACCAGCGATATTTCAGTTCTTACCCGCGAACGTTTTACACACGAGTGAACTTAGACACCTGGAATCTGGATAATACTCAGTGGGTGAATATCACTGACCAGATATATCAGGGTGGCATTGTCAACTCTGGCGTTGGTGTTGGCTCAGTGGTTGTTAAGGATAGTTATATCTATTACATGTTCGGTGGGGAAGACCATCTGAACCCCTGGACATATGGAGATAACTCATCGAAAGACCCATTCAAATCAGATGGTCATCCATCAGATTTGTATTGCTACAAAATGAAGATTGGTTCAGACAATCGTGTTTCCAGGGATTTCAGATATGGTGCTGTACCTGACAGAGCTGTCCCCGTGTTTTTTGATACAAATGGGATTCGCACTGTTCCTGCTCCAATGGAATTTACAGGAGATTTGGGTTTAGGTCATGTGACCCTTAGAGCCAGCACCAGTAGTAACATTCGCTCTGAAGTTTTAATGGAAGGTGAGTATGGGTTTATCGGGAAATCTGTACCGACTAATAACCCAGCAGGGCAGCGCATCATATTTTGCGGGGGAGACGGAACCAGTTCTTCTACTGGTGCACAGATTACGCTTTACGGTGCGAGCAACACAGCTTCTCGCAGGATAGTTTACAACGGAAATGAACATCTGTTTCAGGGTGCTGATGTTAAGCCTTATAACGATAACGTCATTGCGCTTGGTGGACCAAGAAACCGTTTCACCACTGCATACCTCGGAAGTAACCCTATTGTTACTTCTAACGGGGAGAAGAAAACAGAGCCGGTAGTTTTTGATGATGCTTTCCTGGATGCCTGGGGTGACGTTCACTACATCATGTACCAGTGGTTAGATGCTGTTCAACTGAAAGGTAATGATGCTCGTATTCACTTCGGGGTTATTGCTCAACAAATTCGTGATGTATTCATTGCACATGGTCTGATGGATGAAAACAGTACGAATTGTCGTTATGCTGTTCTGTGCTATGACAAGTATCCACGGATGACCGATACGGTATTTTCACACAATGAAATCGTTGAACATACTGACGAGGAGGGTAATGTCACTACTACGGAAGAACCTGTATACACCGAGGTGGTTATTCATGAAGAGGGTGAGGAGTGGGGTGTTCGGCCTGACGGAATTTTCTTTGCTGAAGCCGCTTATCAGAGAAGAAAACTGGAAAGAATCGAAGCCAGACTTTCTGCTCTTGAACAGAAGTAA

Genome Context

Tertiary structure

XQQ52602.1
ESMFold structure
Source ESMFold
pLDDT 60.7
Oligomeric state monomer